| Definition | Agrobacterium vitis S4 plasmid pAtS4e, complete sequence. |
|---|---|
| Accession | NC_011981 |
| Length | 631,775 |
Click here to switch to the map view.
The map label for this gene is cpxA [H]
Identifier: 222102785
GI number: 222102785
Start: 447102
End: 448373
Strand: Direct
Name: cpxA [H]
Synonym: Avi_7490
Alternate gene names: 222102785
Gene position: 447102-448373 (Clockwise)
Preceding gene: 222102784
Following gene: 222102797
Centisome position: 70.77
GC content: 53.3
Gene sequence:
>1272_bases ATGACAAGGCTTTTCCGAAAATTCTTCATTTTCGTCTGGCTGGCGATGACCGTGTCCATTGTTGGCATCATTTCATTGGA TAGGGTCTTCCATCTGTTTCCGCTGAAAAGCGAGAGGCAGCAAGAACGCATCTCGTTTGTCTTGCAGACCATAGGGGAAG TGCTTGAGCAAAAAGGCTTGGTCGAGGCCGGTAAGTTTGCACAGGCTTGGGTCACTTTCGCAAATCCGGTGATTGTTAGT ATTTCGTCCGTGCCGAATCTTCAATGCGCAACGGGTAACGACGAGACCCTGACCATTTACCGCCATCACGACGGCGCTTG TTTCCGTCTTTCCAGTCAACTCAGACATTATAATTTCATCGAGGACGCGCTTCCAGATGCTTTGCCCTGGATCGCCACAG TTATTGCCAGTACGTTATCGGCCCTTTGGATCACGCGCTATCTGGTCGGTCCTGTGGCCAAGCTCAGAAACGGGCTCAGT GCCTTGGCGAAAGGCGATTTTCACACCAGAATCGGTGGCAATTTCGGCAAAGGCCAGGATGAAATCACGGCGCTGGCAAT GGATTTCGATGTGACAGCCGCACGCTTGCAGGAATTGCAGGAAGCGCAACAACGGCTCTTTCATGATGTCTCCCATGAAC TCCGCTCGCCACTCTCGAGATTACAGGCCGTTTTGGGCATGCTGGACAAGAATCCGGGCCGCATCGATATGATCGCCTCG CGTATGGGGCGGGAAGTCATGCGGCTCGACGCCCTTGTCGACGAGATCCTGACGCTGGCACGCATAAGCTCGCCGGAACA TGCACCGCCAGAACGCCAGACTATTGATCTCATTGATCTGATAACCCGGATTGTCGATGACGCCTGCTTTGAAGGGCAGG ATCGGGGGGTCGATGTGACCTATAGCGGCTGCGACAGTTTTATCGCAACATTGAACGGAGAACTCATCTACCGGGCTATA GAGAATGTTGTTCGAAACGCAGTCAAATTTACAACGGACGATTCGACCGTTGCCGTGACGGCGCAGGCGTTTCGGGATGT CCTGTCGATCAGCGTCACAGACAATGGCCCCGGCGTTCCCGCTTGCGATCTAGAGAGGATCTTTCTACCGTTTTCCCGAT CCGAAATAGGTGAAACCGCGAAGGGTCACGGGCTTGGCCTTGCCATTACGCGCAAAGCCCTCGAACTGCATCATGGCAGT GCAGTTGCCAGCCTTACACAAGAAGGTCATCTTTTGATGACGCTGAAAGTGCCAGCTTCTCCTGGCTTATGA
Upstream 100 bases:
>100_bases ACATCAGCAGCGTGCGGCAGAAACTGGGCCGACGCGAGGACGGGCAGTCCTGGATCCAGTCCGTTCGCGGGCAGGGTTAT CAACTCATCCGGGATGTTTG
Downstream 100 bases:
>100_bases AACAGCACCGAAGACTGGGTCTGACTCATATGTGGAACGGCCCGGGGCTTGTCGCAAAGATTTTCGTGGGTCTCGATTAT CCCCTAAACGGTGTGTATTT
Product: Signal transduction histidine kinase
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 423; Mature: 422
Protein sequence:
>423_residues MTRLFRKFFIFVWLAMTVSIVGIISLDRVFHLFPLKSERQQERISFVLQTIGEVLEQKGLVEAGKFAQAWVTFANPVIVS ISSVPNLQCATGNDETLTIYRHHDGACFRLSSQLRHYNFIEDALPDALPWIATVIASTLSALWITRYLVGPVAKLRNGLS ALAKGDFHTRIGGNFGKGQDEITALAMDFDVTAARLQELQEAQQRLFHDVSHELRSPLSRLQAVLGMLDKNPGRIDMIAS RMGREVMRLDALVDEILTLARISSPEHAPPERQTIDLIDLITRIVDDACFEGQDRGVDVTYSGCDSFIATLNGELIYRAI ENVVRNAVKFTTDDSTVAVTAQAFRDVLSISVTDNGPGVPACDLERIFLPFSRSEIGETAKGHGLGLAITRKALELHHGS AVASLTQEGHLLMTLKVPASPGL
Sequences:
>Translated_423_residues MTRLFRKFFIFVWLAMTVSIVGIISLDRVFHLFPLKSERQQERISFVLQTIGEVLEQKGLVEAGKFAQAWVTFANPVIVS ISSVPNLQCATGNDETLTIYRHHDGACFRLSSQLRHYNFIEDALPDALPWIATVIASTLSALWITRYLVGPVAKLRNGLS ALAKGDFHTRIGGNFGKGQDEITALAMDFDVTAARLQELQEAQQRLFHDVSHELRSPLSRLQAVLGMLDKNPGRIDMIAS RMGREVMRLDALVDEILTLARISSPEHAPPERQTIDLIDLITRIVDDACFEGQDRGVDVTYSGCDSFIATLNGELIYRAI ENVVRNAVKFTTDDSTVAVTAQAFRDVLSISVTDNGPGVPACDLERIFLPFSRSEIGETAKGHGLGLAITRKALELHHGS AVASLTQEGHLLMTLKVPASPGL >Mature_422_residues TRLFRKFFIFVWLAMTVSIVGIISLDRVFHLFPLKSERQQERISFVLQTIGEVLEQKGLVEAGKFAQAWVTFANPVIVSI SSVPNLQCATGNDETLTIYRHHDGACFRLSSQLRHYNFIEDALPDALPWIATVIASTLSALWITRYLVGPVAKLRNGLSA LAKGDFHTRIGGNFGKGQDEITALAMDFDVTAARLQELQEAQQRLFHDVSHELRSPLSRLQAVLGMLDKNPGRIDMIASR MGREVMRLDALVDEILTLARISSPEHAPPERQTIDLIDLITRIVDDACFEGQDRGVDVTYSGCDSFIATLNGELIYRAIE NVVRNAVKFTTDDSTVAVTAQAFRDVLSISVTDNGPGVPACDLERIFLPFSRSEIGETAKGHGLGLAITRKALELHHGSA VASLTQEGHLLMTLKVPASPGL
Specific function: This protein is involved in several diverse cellular processes, such as the functioning of acetohydroxyacid synthetase I, in the biosynthesis of isoleucine and valine, the TraJ protein activation activity for tra gene expression in F plasmid, and the synt
COG id: NA
COG function: NA
Gene ontology:
Cell location: Cell inner membrane; Multi-pass membrane protein [H]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 1 histidine kinase domain [H]
Homologues:
Organism=Escherichia coli, GI1790346, Length=291, Percent_Identity=31.2714776632302, Blast_Score=126, Evalue=2e-30, Organism=Escherichia coli, GI1788393, Length=279, Percent_Identity=28.673835125448, Blast_Score=106, Evalue=3e-24, Organism=Escherichia coli, GI1786600, Length=217, Percent_Identity=31.7972350230415, Blast_Score=92, Evalue=8e-20, Organism=Escherichia coli, GI1789808, Length=242, Percent_Identity=24.7933884297521, Blast_Score=79, Evalue=8e-16, Organism=Escherichia coli, GI1786783, Length=242, Percent_Identity=25.2066115702479, Blast_Score=77, Evalue=1e-15, Organism=Escherichia coli, GI1790436, Length=204, Percent_Identity=28.4313725490196, Blast_Score=76, Evalue=3e-15, Organism=Escherichia coli, GI1787894, Length=246, Percent_Identity=28.0487804878049, Blast_Score=76, Evalue=5e-15, Organism=Escherichia coli, GI1790861, Length=244, Percent_Identity=23.3606557377049, Blast_Score=74, Evalue=1e-14, Organism=Escherichia coli, GI1789403, Length=221, Percent_Identity=31.6742081447964, Blast_Score=72, Evalue=7e-14, Organism=Escherichia coli, GI145693157, Length=272, Percent_Identity=27.5735294117647, Blast_Score=71, Evalue=1e-13, Organism=Escherichia coli, GI1786912, Length=225, Percent_Identity=27.1111111111111, Blast_Score=69, Evalue=6e-13, Organism=Escherichia coli, GI1789149, Length=274, Percent_Identity=23.3576642335766, Blast_Score=67, Evalue=2e-12, Organism=Escherichia coli, GI1788549, Length=252, Percent_Identity=27.3809523809524, Blast_Score=62, Evalue=9e-11,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR003594 - InterPro: IPR003660 - InterPro: IPR004358 - InterPro: IPR003661 - InterPro: IPR005467 - InterPro: IPR009082 [H]
Pfam domain/function: PF00672 HAMP; PF02518 HATPase_c; PF00512 HisKA [H]
EC number: =2.7.13.3 [H]
Molecular weight: Translated: 46604; Mature: 46473
Theoretical pI: Translated: 6.24; Mature: 6.24
Prosite motif: PS50885 HAMP ; PS50109 HIS_KIN
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.2 %Cys (Translated Protein) 1.9 %Met (Translated Protein) 3.1 %Cys+Met (Translated Protein) 1.2 %Cys (Mature Protein) 1.7 %Met (Mature Protein) 2.8 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MTRLFRKFFIFVWLAMTVSIVGIISLDRVFHLFPLKSERQQERISFVLQTIGEVLEQKGL CHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHCCC VEAGKFAQAWVTFANPVIVSISSVPNLQCATGNDETLTIYRHHDGACFRLSSQLRHYNFI HHHHHHHHHHHHHCCCEEEEECCCCCEEEECCCCCEEEEEEECCCHHHHHHHHHHHHHHH EDALPDALPWIATVIASTLSALWITRYLVGPVAKLRNGLSALAKGDFHTRIGGNFGKGQD HHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHCCCCCCCCCCH EITALAMDFDVTAARLQELQEAQQRLFHDVSHELRSPLSRLQAVLGMLDKNPGRIDMIAS HHEEEEECCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHH RMGREVMRLDALVDEILTLARISSPEHAPPERQTIDLIDLITRIVDDACFEGQDRGVDVT HHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHHHCCCCCCCEEEE YSGCDSFIATLNGELIYRAIENVVRNAVKFTTDDSTVAVTAQAFRDVLSISVTDNGPGVP ECCHHHHHHHHCHHHHHHHHHHHHHHHHEECCCCCEEEEEHHHHHHHHEEEEECCCCCCC ACDLERIFLPFSRSEIGETAKGHGLGLAITRKALELHHGSAVASLTQEGHLLMTLKVPAS CCCHHHHCCCCCHHHHCCCCCCCCCCHHHHHHHHHHHCCHHHHHHCCCCCEEEEEECCCC PGL CCC >Mature Secondary Structure TRLFRKFFIFVWLAMTVSIVGIISLDRVFHLFPLKSERQQERISFVLQTIGEVLEQKGL HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHCCC VEAGKFAQAWVTFANPVIVSISSVPNLQCATGNDETLTIYRHHDGACFRLSSQLRHYNFI HHHHHHHHHHHHHCCCEEEEECCCCCEEEECCCCCEEEEEEECCCHHHHHHHHHHHHHHH EDALPDALPWIATVIASTLSALWITRYLVGPVAKLRNGLSALAKGDFHTRIGGNFGKGQD HHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHCCCCCCCCCCH EITALAMDFDVTAARLQELQEAQQRLFHDVSHELRSPLSRLQAVLGMLDKNPGRIDMIAS HHEEEEECCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHH RMGREVMRLDALVDEILTLARISSPEHAPPERQTIDLIDLITRIVDDACFEGQDRGVDVT HHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHHHCCCCCCCEEEE YSGCDSFIATLNGELIYRAIENVVRNAVKFTTDDSTVAVTAQAFRDVLSISVTDNGPGVP ECCHHHHHHHHCHHHHHHHHHHHHHHHHEECCCCCEEEEEHHHHHHHHEEEEECCCCCCC ACDLERIFLPFSRSEIGETAKGHGLGLAITRKALELHHGSAVASLTQEGHLLMTLKVPAS CCCHHHHCCCCCHHHHCCCCCCCCCCHHHHHHHHHHHCCHHHHHHCCCCCEEEEEECCCC PGL CCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 6.0
TargetDB status: NA
Availability: NA
References: 11206551; 11258796 [H]