| Definition | Agrobacterium vitis S4 plasmid pAtS4e, complete sequence. |
|---|---|
| Accession | NC_011981 |
| Length | 631,775 |
Click here to switch to the map view.
The map label for this gene is mcpA [H]
Identifier: 222102896
GI number: 222102896
Start: 577013
End: 578740
Strand: Reverse
Name: mcpA [H]
Synonym: Avi_7643
Alternate gene names: 222102896
Gene position: 578740-577013 (Counterclockwise)
Preceding gene: 222102902
Following gene: 222102894
Centisome position: 91.61
GC content: 52.37
Gene sequence:
>1728_bases ATGGGATTGTTGTCAATTGTATTCGGAAGCGACATCAAAGCTATTTTCGATGCCATAAATCGGTCTCAAGGCGTCATTGA ATTCGACATCCAGGGCAATATTCTTGATGCGAATGACAATTTCTGCAAGACGCTTGGATATGCAAAATCAGATATCATTG GCAAACACCATCGGATCTTTCTCGATCCTGAAGAGGTGAAGACTAAAGCCTATGCCGATTTCTGGGCAAAACTCGTTTCC GGCCAGTTCGACCAGCGCCAATATAAGCGGTTCACCAAATCGGGCGACCCCATCTGGATCGAAGCCTCTTACAATCCGGT TTTTCGCGGGGGTAAGCCTTACAAAATTGTAAAAATTGCCACGGACATTACGGCGTCCACAAACAAAGCTATGGATGGCG ACGGCAAGATGGAAGCGTTGTTGCGTTCTCAGGCCGTTATCGAGTTCACACCGACTGGCCAGATTTTGACTGCCAACGAG AATTTCTGCAAGGCGATGAACTACGACCTCAGCGAGATCATTGGCAAAAATCATTCGATGTTTTGTGAACAAGCTTACAT CGCGTCCCCCGATTACAAAGAGTTCTGGCGCAAGCTTGGAGCAGATGAGTTCCAGAGCGACGAGTTCTTGCGGATCGGGA AAGGTGGCAAGAAAGTCTATATTCAGGCCACTTATAACCCCATCACAGATGAAAAGGGAAAGGTCGTCAAGGTTGTGAAA TTCGCGATCGATGTCACCGGCCGCGTCAACGCCATTGCTGCGATTGGTGCAGGTCTTGAGCGCTTGTCCGACTGCAATAT CCGAATGACGATTGATGAGCCGTTCATTCCAACCTTCGAGCACTTGCGTAAAGACTTCAACATGTCCATTGGCAAATTCC AGGAAACCCTGGCGCAGGTGCTGGCGGAAACGGCGGCGGTTTCCGCCAATAGTCATGATATGCTCAAGGGATCGACCAGC CTGGCAAAACGCTCGGAGCAACAGGCTGCCGCACTGGAGCAGACTTCTGCGGCATTGGAAGAAATAACCGCGACGGTGAG AGAATCCAGTGCGCGTTCCAAAGATACTCGAAACTTGGTGCGCGACGCTCGTCAGGCCGCAACCGAGTCCGTAAAGGTCG TTAACTTCACCGTCGCCGCCATGAGCCGCATCGAGGGCGCTTCGAAGGAAATCAGTAATATCATCACTGTTATCGATGAA ATTGCCTTCCAGACCAACCTTTTAGCCCTGAATGCAGGCGTCGAAGCAGCCCGCGCTGGTGAAAGTGGCAAGGGCTTTGC GGTCGTGGCCCAGGAGGTCCGTGAGTTGGCTCAACGCTCCGCCAAGGCCGCCAAGGAAATTTCGGAATTGATCGCTAAAT CGACCAATGAAGTGAAGGACGGTGTACGTCTGGTCGGGGAAACCGGCAGTGCGCTGAACCGGATCGAGTCCTTCGTGCAA TCTATCGATGTTAATATTGAAGCCATTTCCACGGCAGCGTCGGAGCAATCCACTAGCCTCACGGAAATCAGCACTGCGGT CAACGCCTTAGACCAGATGACACAACAGAACGCGGGAATGGTCAGCGGCATGAATGCCATCAGCGAAGCACTTTCCAGTG GCGCGGCTAAACTGAGCGAACTGGCAAACCGCTTCCAGCTCAACAGGCGCAGTGCCATCCGCGAGCCGGGAAGTTCCGCT GCAATGCGTGACAACGACAGGCGGGAAAGCAATCGCTCGGCGGCCTGA
Upstream 100 bases:
>100_bases GCAAAAATAAAAAAACGATCTTTTGGTATTTATTTTGTAATATTTATTATTCCTAAATAATATATATTATAATGTTCCGC TATCAATAGGAGACGGCGCT
Downstream 100 bases:
>100_bases CCGACAGACTATTTATGACCTGTATTAACGCTCAGTCAGCGGCGTCAGAATGGTCCAAGTATCAACGCTCGTGGATCAAA AATTGAACACGCCGGACGCC
Product: sensory methylation accepting chemotaxis protein
Products: NA
Alternate protein names: Methyl-accepting chemotaxis protein [H]
Number of amino acids: Translated: 575; Mature: 574
Protein sequence:
>575_residues MGLLSIVFGSDIKAIFDAINRSQGVIEFDIQGNILDANDNFCKTLGYAKSDIIGKHHRIFLDPEEVKTKAYADFWAKLVS GQFDQRQYKRFTKSGDPIWIEASYNPVFRGGKPYKIVKIATDITASTNKAMDGDGKMEALLRSQAVIEFTPTGQILTANE NFCKAMNYDLSEIIGKNHSMFCEQAYIASPDYKEFWRKLGADEFQSDEFLRIGKGGKKVYIQATYNPITDEKGKVVKVVK FAIDVTGRVNAIAAIGAGLERLSDCNIRMTIDEPFIPTFEHLRKDFNMSIGKFQETLAQVLAETAAVSANSHDMLKGSTS LAKRSEQQAAALEQTSAALEEITATVRESSARSKDTRNLVRDARQAATESVKVVNFTVAAMSRIEGASKEISNIITVIDE IAFQTNLLALNAGVEAARAGESGKGFAVVAQEVRELAQRSAKAAKEISELIAKSTNEVKDGVRLVGETGSALNRIESFVQ SIDVNIEAISTAASEQSTSLTEISTAVNALDQMTQQNAGMVSGMNAISEALSSGAAKLSELANRFQLNRRSAIREPGSSA AMRDNDRRESNRSAA
Sequences:
>Translated_575_residues MGLLSIVFGSDIKAIFDAINRSQGVIEFDIQGNILDANDNFCKTLGYAKSDIIGKHHRIFLDPEEVKTKAYADFWAKLVS GQFDQRQYKRFTKSGDPIWIEASYNPVFRGGKPYKIVKIATDITASTNKAMDGDGKMEALLRSQAVIEFTPTGQILTANE NFCKAMNYDLSEIIGKNHSMFCEQAYIASPDYKEFWRKLGADEFQSDEFLRIGKGGKKVYIQATYNPITDEKGKVVKVVK FAIDVTGRVNAIAAIGAGLERLSDCNIRMTIDEPFIPTFEHLRKDFNMSIGKFQETLAQVLAETAAVSANSHDMLKGSTS LAKRSEQQAAALEQTSAALEEITATVRESSARSKDTRNLVRDARQAATESVKVVNFTVAAMSRIEGASKEISNIITVIDE IAFQTNLLALNAGVEAARAGESGKGFAVVAQEVRELAQRSAKAAKEISELIAKSTNEVKDGVRLVGETGSALNRIESFVQ SIDVNIEAISTAASEQSTSLTEISTAVNALDQMTQQNAGMVSGMNAISEALSSGAAKLSELANRFQLNRRSAIREPGSSA AMRDNDRRESNRSAA >Mature_574_residues GLLSIVFGSDIKAIFDAINRSQGVIEFDIQGNILDANDNFCKTLGYAKSDIIGKHHRIFLDPEEVKTKAYADFWAKLVSG QFDQRQYKRFTKSGDPIWIEASYNPVFRGGKPYKIVKIATDITASTNKAMDGDGKMEALLRSQAVIEFTPTGQILTANEN FCKAMNYDLSEIIGKNHSMFCEQAYIASPDYKEFWRKLGADEFQSDEFLRIGKGGKKVYIQATYNPITDEKGKVVKVVKF AIDVTGRVNAIAAIGAGLERLSDCNIRMTIDEPFIPTFEHLRKDFNMSIGKFQETLAQVLAETAAVSANSHDMLKGSTSL AKRSEQQAAALEQTSAALEEITATVRESSARSKDTRNLVRDARQAATESVKVVNFTVAAMSRIEGASKEISNIITVIDEI AFQTNLLALNAGVEAARAGESGKGFAVVAQEVRELAQRSAKAAKEISELIAKSTNEVKDGVRLVGETGSALNRIESFVQS IDVNIEAISTAASEQSTSLTEISTAVNALDQMTQQNAGMVSGMNAISEALSSGAAKLSELANRFQLNRRSAIREPGSSAA MRDNDRRESNRSAA
Specific function: Chemotactic-signal transducers respond to changes in the concentration of attractants and repellents in the environment, transduce a signal from the outside to the inside of the cell, and facilitate sensory adaptation through the variation of the level of
COG id: NA
COG function: NA
Gene ontology:
Cell location: Cell membrane; Multi-pass membrane protein. Note=Localized at the flagellum-bearing pole of the swarmer cell [H]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 1 methyl-accepting transducer domain [H]
Homologues:
Organism=Escherichia coli, GI1787690, Length=306, Percent_Identity=37.5816993464052, Blast_Score=185, Evalue=8e-48, Organism=Escherichia coli, GI1788195, Length=294, Percent_Identity=39.7959183673469, Blast_Score=184, Evalue=1e-47, Organism=Escherichia coli, GI2367378, Length=227, Percent_Identity=43.6123348017621, Blast_Score=169, Evalue=7e-43, Organism=Escherichia coli, GI1788194, Length=243, Percent_Identity=41.9753086419753, Blast_Score=166, Evalue=4e-42, Organism=Escherichia coli, GI1789453, Length=241, Percent_Identity=36.0995850622407, Blast_Score=137, Evalue=2e-33,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR004090 - InterPro: IPR004089 - InterPro: IPR003660 [H]
Pfam domain/function: PF00672 HAMP; PF00015 MCPsignal [H]
EC number: NA
Molecular weight: Translated: 62646; Mature: 62515
Theoretical pI: Translated: 6.15; Mature: 6.15
Prosite motif: PS50112 PAS ; PS50113 PAC ; PS50111 CHEMOTAXIS_TRANSDUC_2
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.7 %Cys (Translated Protein) 2.3 %Met (Translated Protein) 3.0 %Cys+Met (Translated Protein) 0.7 %Cys (Mature Protein) 2.1 %Met (Mature Protein) 2.8 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MGLLSIVFGSDIKAIFDAINRSQGVIEFDIQGNILDANDNFCKTLGYAKSDIIGKHHRIF CCCEEEECCCCHHHHHHHHCCCCCEEEEEECCCEECCCCCHHHHHCCHHHHHCCCCCEEE LDPEEVKTKAYADFWAKLVSGQFDQRQYKRFTKSGDPIWIEASYNPVFRGGKPYKIVKIA ECHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHCCCCCEEEEECCCCCCCCCCCEEEEEEE TDITASTNKAMDGDGKMEALLRSQAVIEFTPTGQILTANENFCKAMNYDLSEIIGKNHSM ECCCCCCCCCCCCCHHHHHHHHCCCEEEECCCCCEEECCCHHHHHCCCCHHHHHCCCCCH FCEQAYIASPDYKEFWRKLGADEFQSDEFLRIGKGGKKVYIQATYNPITDEKGKVVKVVK HHHHHHCCCCCHHHHHHHCCCCCCCCCCEEEECCCCCEEEEEEECCCCCCCCCCEEEEHH FAIDVTGRVNAIAAIGAGLERLSDCNIRMTIDEPFIPTFEHLRKDFNMSIGKFQETLAQV HHHHCCCCHHHHHHHHHHHHHHCCCCEEEEECCCCCCHHHHHHHHHCCCHHHHHHHHHHH LAETAAVSANSHDMLKGSTSLAKRSEQQAAALEQTSAALEEITATVRESSARSKDTRNLV HHHHHHCCCCCCHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHH RDARQAATESVKVVNFTVAAMSRIEGASKEISNIITVIDEIAFQTNLLALNAGVEAARAG HHHHHHHHCCCHHEEHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHCEEEEECCCHHHHCC ESGKGFAVVAQEVRELAQRSAKAAKEISELIAKSTNEVKDGVRLVGETGSALNRIESFVQ CCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHCCCCHHHHHHHHHHH SIDVNIEAISTAASEQSTSLTEISTAVNALDQMTQQNAGMVSGMNAISEALSSGAAKLSE HHCCCHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHH LANRFQLNRRSAIREPGSSAAMRDNDRRESNRSAA HHHHHHHHHHHHHCCCCCCCCCCCCCHHCCCCCCC >Mature Secondary Structure GLLSIVFGSDIKAIFDAINRSQGVIEFDIQGNILDANDNFCKTLGYAKSDIIGKHHRIF CCEEEECCCCHHHHHHHHCCCCCEEEEEECCCEECCCCCHHHHHCCHHHHHCCCCCEEE LDPEEVKTKAYADFWAKLVSGQFDQRQYKRFTKSGDPIWIEASYNPVFRGGKPYKIVKIA ECHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHCCCCCEEEEECCCCCCCCCCCEEEEEEE TDITASTNKAMDGDGKMEALLRSQAVIEFTPTGQILTANENFCKAMNYDLSEIIGKNHSM ECCCCCCCCCCCCCHHHHHHHHCCCEEEECCCCCEEECCCHHHHHCCCCHHHHHCCCCCH FCEQAYIASPDYKEFWRKLGADEFQSDEFLRIGKGGKKVYIQATYNPITDEKGKVVKVVK HHHHHHCCCCCHHHHHHHCCCCCCCCCCEEEECCCCCEEEEEEECCCCCCCCCCEEEEHH FAIDVTGRVNAIAAIGAGLERLSDCNIRMTIDEPFIPTFEHLRKDFNMSIGKFQETLAQV HHHHCCCCHHHHHHHHHHHHHHCCCCEEEEECCCCCCHHHHHHHHHCCCHHHHHHHHHHH LAETAAVSANSHDMLKGSTSLAKRSEQQAAALEQTSAALEEITATVRESSARSKDTRNLV HHHHHHCCCCCCHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHH RDARQAATESVKVVNFTVAAMSRIEGASKEISNIITVIDEIAFQTNLLALNAGVEAARAG HHHHHHHHCCCHHEEHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHCEEEEECCCHHHHCC ESGKGFAVVAQEVRELAQRSAKAAKEISELIAKSTNEVKDGVRLVGETGSALNRIESFVQ CCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHCCCCHHHHHHHHHHH SIDVNIEAISTAASEQSTSLTEISTAVNALDQMTQQNAGMVSGMNAISEALSSGAAKLSE HHCCCHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHH LANRFQLNRRSAIREPGSSAAMRDNDRRESNRSAA HHHHHHHHHHHHHCCCCCCCCCCCCCHHCCCCCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 6.0
TargetDB status: NA
Availability: NA
References: 1577276; 11259647 [H]