Definition Agrobacterium vitis S4 plasmid pAtS4e, complete sequence.
Accession NC_011981
Length 631,775

Click here to switch to the map view.

The map label for this gene is cpxA [H]

Identifier: 222102785

GI number: 222102785

Start: 447102

End: 448373

Strand: Direct

Name: cpxA [H]

Synonym: Avi_7490

Alternate gene names: 222102785

Gene position: 447102-448373 (Clockwise)

Preceding gene: 222102784

Following gene: 222102797

Centisome position: 70.77

GC content: 53.3

Gene sequence:

>1272_bases
ATGACAAGGCTTTTCCGAAAATTCTTCATTTTCGTCTGGCTGGCGATGACCGTGTCCATTGTTGGCATCATTTCATTGGA
TAGGGTCTTCCATCTGTTTCCGCTGAAAAGCGAGAGGCAGCAAGAACGCATCTCGTTTGTCTTGCAGACCATAGGGGAAG
TGCTTGAGCAAAAAGGCTTGGTCGAGGCCGGTAAGTTTGCACAGGCTTGGGTCACTTTCGCAAATCCGGTGATTGTTAGT
ATTTCGTCCGTGCCGAATCTTCAATGCGCAACGGGTAACGACGAGACCCTGACCATTTACCGCCATCACGACGGCGCTTG
TTTCCGTCTTTCCAGTCAACTCAGACATTATAATTTCATCGAGGACGCGCTTCCAGATGCTTTGCCCTGGATCGCCACAG
TTATTGCCAGTACGTTATCGGCCCTTTGGATCACGCGCTATCTGGTCGGTCCTGTGGCCAAGCTCAGAAACGGGCTCAGT
GCCTTGGCGAAAGGCGATTTTCACACCAGAATCGGTGGCAATTTCGGCAAAGGCCAGGATGAAATCACGGCGCTGGCAAT
GGATTTCGATGTGACAGCCGCACGCTTGCAGGAATTGCAGGAAGCGCAACAACGGCTCTTTCATGATGTCTCCCATGAAC
TCCGCTCGCCACTCTCGAGATTACAGGCCGTTTTGGGCATGCTGGACAAGAATCCGGGCCGCATCGATATGATCGCCTCG
CGTATGGGGCGGGAAGTCATGCGGCTCGACGCCCTTGTCGACGAGATCCTGACGCTGGCACGCATAAGCTCGCCGGAACA
TGCACCGCCAGAACGCCAGACTATTGATCTCATTGATCTGATAACCCGGATTGTCGATGACGCCTGCTTTGAAGGGCAGG
ATCGGGGGGTCGATGTGACCTATAGCGGCTGCGACAGTTTTATCGCAACATTGAACGGAGAACTCATCTACCGGGCTATA
GAGAATGTTGTTCGAAACGCAGTCAAATTTACAACGGACGATTCGACCGTTGCCGTGACGGCGCAGGCGTTTCGGGATGT
CCTGTCGATCAGCGTCACAGACAATGGCCCCGGCGTTCCCGCTTGCGATCTAGAGAGGATCTTTCTACCGTTTTCCCGAT
CCGAAATAGGTGAAACCGCGAAGGGTCACGGGCTTGGCCTTGCCATTACGCGCAAAGCCCTCGAACTGCATCATGGCAGT
GCAGTTGCCAGCCTTACACAAGAAGGTCATCTTTTGATGACGCTGAAAGTGCCAGCTTCTCCTGGCTTATGA

Upstream 100 bases:

>100_bases
ACATCAGCAGCGTGCGGCAGAAACTGGGCCGACGCGAGGACGGGCAGTCCTGGATCCAGTCCGTTCGCGGGCAGGGTTAT
CAACTCATCCGGGATGTTTG

Downstream 100 bases:

>100_bases
AACAGCACCGAAGACTGGGTCTGACTCATATGTGGAACGGCCCGGGGCTTGTCGCAAAGATTTTCGTGGGTCTCGATTAT
CCCCTAAACGGTGTGTATTT

Product: Signal transduction histidine kinase

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 423; Mature: 422

Protein sequence:

>423_residues
MTRLFRKFFIFVWLAMTVSIVGIISLDRVFHLFPLKSERQQERISFVLQTIGEVLEQKGLVEAGKFAQAWVTFANPVIVS
ISSVPNLQCATGNDETLTIYRHHDGACFRLSSQLRHYNFIEDALPDALPWIATVIASTLSALWITRYLVGPVAKLRNGLS
ALAKGDFHTRIGGNFGKGQDEITALAMDFDVTAARLQELQEAQQRLFHDVSHELRSPLSRLQAVLGMLDKNPGRIDMIAS
RMGREVMRLDALVDEILTLARISSPEHAPPERQTIDLIDLITRIVDDACFEGQDRGVDVTYSGCDSFIATLNGELIYRAI
ENVVRNAVKFTTDDSTVAVTAQAFRDVLSISVTDNGPGVPACDLERIFLPFSRSEIGETAKGHGLGLAITRKALELHHGS
AVASLTQEGHLLMTLKVPASPGL

Sequences:

>Translated_423_residues
MTRLFRKFFIFVWLAMTVSIVGIISLDRVFHLFPLKSERQQERISFVLQTIGEVLEQKGLVEAGKFAQAWVTFANPVIVS
ISSVPNLQCATGNDETLTIYRHHDGACFRLSSQLRHYNFIEDALPDALPWIATVIASTLSALWITRYLVGPVAKLRNGLS
ALAKGDFHTRIGGNFGKGQDEITALAMDFDVTAARLQELQEAQQRLFHDVSHELRSPLSRLQAVLGMLDKNPGRIDMIAS
RMGREVMRLDALVDEILTLARISSPEHAPPERQTIDLIDLITRIVDDACFEGQDRGVDVTYSGCDSFIATLNGELIYRAI
ENVVRNAVKFTTDDSTVAVTAQAFRDVLSISVTDNGPGVPACDLERIFLPFSRSEIGETAKGHGLGLAITRKALELHHGS
AVASLTQEGHLLMTLKVPASPGL
>Mature_422_residues
TRLFRKFFIFVWLAMTVSIVGIISLDRVFHLFPLKSERQQERISFVLQTIGEVLEQKGLVEAGKFAQAWVTFANPVIVSI
SSVPNLQCATGNDETLTIYRHHDGACFRLSSQLRHYNFIEDALPDALPWIATVIASTLSALWITRYLVGPVAKLRNGLSA
LAKGDFHTRIGGNFGKGQDEITALAMDFDVTAARLQELQEAQQRLFHDVSHELRSPLSRLQAVLGMLDKNPGRIDMIASR
MGREVMRLDALVDEILTLARISSPEHAPPERQTIDLIDLITRIVDDACFEGQDRGVDVTYSGCDSFIATLNGELIYRAIE
NVVRNAVKFTTDDSTVAVTAQAFRDVLSISVTDNGPGVPACDLERIFLPFSRSEIGETAKGHGLGLAITRKALELHHGSA
VASLTQEGHLLMTLKVPASPGL

Specific function: This protein is involved in several diverse cellular processes, such as the functioning of acetohydroxyacid synthetase I, in the biosynthesis of isoleucine and valine, the TraJ protein activation activity for tra gene expression in F plasmid, and the synt

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cell inner membrane; Multi-pass membrane protein [H]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 histidine kinase domain [H]

Homologues:

Organism=Escherichia coli, GI1790346, Length=291, Percent_Identity=31.2714776632302, Blast_Score=126, Evalue=2e-30,
Organism=Escherichia coli, GI1788393, Length=279, Percent_Identity=28.673835125448, Blast_Score=106, Evalue=3e-24,
Organism=Escherichia coli, GI1786600, Length=217, Percent_Identity=31.7972350230415, Blast_Score=92, Evalue=8e-20,
Organism=Escherichia coli, GI1789808, Length=242, Percent_Identity=24.7933884297521, Blast_Score=79, Evalue=8e-16,
Organism=Escherichia coli, GI1786783, Length=242, Percent_Identity=25.2066115702479, Blast_Score=77, Evalue=1e-15,
Organism=Escherichia coli, GI1790436, Length=204, Percent_Identity=28.4313725490196, Blast_Score=76, Evalue=3e-15,
Organism=Escherichia coli, GI1787894, Length=246, Percent_Identity=28.0487804878049, Blast_Score=76, Evalue=5e-15,
Organism=Escherichia coli, GI1790861, Length=244, Percent_Identity=23.3606557377049, Blast_Score=74, Evalue=1e-14,
Organism=Escherichia coli, GI1789403, Length=221, Percent_Identity=31.6742081447964, Blast_Score=72, Evalue=7e-14,
Organism=Escherichia coli, GI145693157, Length=272, Percent_Identity=27.5735294117647, Blast_Score=71, Evalue=1e-13,
Organism=Escherichia coli, GI1786912, Length=225, Percent_Identity=27.1111111111111, Blast_Score=69, Evalue=6e-13,
Organism=Escherichia coli, GI1789149, Length=274, Percent_Identity=23.3576642335766, Blast_Score=67, Evalue=2e-12,
Organism=Escherichia coli, GI1788549, Length=252, Percent_Identity=27.3809523809524, Blast_Score=62, Evalue=9e-11,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR003594
- InterPro:   IPR003660
- InterPro:   IPR004358
- InterPro:   IPR003661
- InterPro:   IPR005467
- InterPro:   IPR009082 [H]

Pfam domain/function: PF00672 HAMP; PF02518 HATPase_c; PF00512 HisKA [H]

EC number: =2.7.13.3 [H]

Molecular weight: Translated: 46604; Mature: 46473

Theoretical pI: Translated: 6.24; Mature: 6.24

Prosite motif: PS50885 HAMP ; PS50109 HIS_KIN

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.2 %Cys     (Translated Protein)
1.9 %Met     (Translated Protein)
3.1 %Cys+Met (Translated Protein)
1.2 %Cys     (Mature Protein)
1.7 %Met     (Mature Protein)
2.8 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MTRLFRKFFIFVWLAMTVSIVGIISLDRVFHLFPLKSERQQERISFVLQTIGEVLEQKGL
CHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHCCC
VEAGKFAQAWVTFANPVIVSISSVPNLQCATGNDETLTIYRHHDGACFRLSSQLRHYNFI
HHHHHHHHHHHHHCCCEEEEECCCCCEEEECCCCCEEEEEEECCCHHHHHHHHHHHHHHH
EDALPDALPWIATVIASTLSALWITRYLVGPVAKLRNGLSALAKGDFHTRIGGNFGKGQD
HHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHCCCCCCCCCCH
EITALAMDFDVTAARLQELQEAQQRLFHDVSHELRSPLSRLQAVLGMLDKNPGRIDMIAS
HHEEEEECCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHH
RMGREVMRLDALVDEILTLARISSPEHAPPERQTIDLIDLITRIVDDACFEGQDRGVDVT
HHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHHHCCCCCCCEEEE
YSGCDSFIATLNGELIYRAIENVVRNAVKFTTDDSTVAVTAQAFRDVLSISVTDNGPGVP
ECCHHHHHHHHCHHHHHHHHHHHHHHHHEECCCCCEEEEEHHHHHHHHEEEEECCCCCCC
ACDLERIFLPFSRSEIGETAKGHGLGLAITRKALELHHGSAVASLTQEGHLLMTLKVPAS
CCCHHHHCCCCCHHHHCCCCCCCCCCHHHHHHHHHHHCCHHHHHHCCCCCEEEEEECCCC
PGL
CCC
>Mature Secondary Structure 
TRLFRKFFIFVWLAMTVSIVGIISLDRVFHLFPLKSERQQERISFVLQTIGEVLEQKGL
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHCCC
VEAGKFAQAWVTFANPVIVSISSVPNLQCATGNDETLTIYRHHDGACFRLSSQLRHYNFI
HHHHHHHHHHHHHCCCEEEEECCCCCEEEECCCCCEEEEEEECCCHHHHHHHHHHHHHHH
EDALPDALPWIATVIASTLSALWITRYLVGPVAKLRNGLSALAKGDFHTRIGGNFGKGQD
HHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHCCCCCCCCCCH
EITALAMDFDVTAARLQELQEAQQRLFHDVSHELRSPLSRLQAVLGMLDKNPGRIDMIAS
HHEEEEECCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHH
RMGREVMRLDALVDEILTLARISSPEHAPPERQTIDLIDLITRIVDDACFEGQDRGVDVT
HHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHHHCCCCCCCEEEE
YSGCDSFIATLNGELIYRAIENVVRNAVKFTTDDSTVAVTAQAFRDVLSISVTDNGPGVP
ECCHHHHHHHHCHHHHHHHHHHHHHHHHEECCCCCEEEEEHHHHHHHHEEEEECCCCCCC
ACDLERIFLPFSRSEIGETAKGHGLGLAITRKALELHHGSAVASLTQEGHLLMTLKVPAS
CCCHHHHCCCCCHHHHCCCCCCCCCCHHHHHHHHHHHCCHHHHHHCCCCCEEEEEECCCC
PGL
CCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 11206551; 11258796 [H]