| Definition | Rhodospirillum rubrum ATCC 11170 chromosome, complete genome. |
|---|---|
| Accession | NC_007643 |
| Length | 4,352,825 |
Click here to switch to the map view.
The map label for this gene is yheS [H]
Identifier: 83593505
GI number: 83593505
Start: 2519018
End: 2520955
Strand: Direct
Name: yheS [H]
Synonym: Rru_A2170
Alternate gene names: 83593505
Gene position: 2519018-2520955 (Clockwise)
Preceding gene: 83593503
Following gene: 83593506
Centisome position: 57.87
GC content: 67.03
Gene sequence:
>1938_bases ATGCTGCACATCAAATCCCTGACCTACCGCATCGGCGGTCGCACCCTGCTTGACGAGGCCACCGCCCATATTCCCGAAGG CCAGCGCATCGGACTGATCGGTCGCAACGGCACCGGCAAGACCACGCTGTTTCGCCTGATCCTTGGTGAATTGAGCGGCG ATGGCGGATCGATCGCCGTCCGCCCGCGCGCCCGGGTCGGTCAGGTCGCCCAGGAGGCTCCCGACGGCGACACCACGCTG CTTGACTGCGTGCTGGCCGCCGATGCCGAACGCGCCAGCCTGCTCGCCGCGCTTGAAGGCGACACCGATCCCCATCATCT GGGCGAAATCCATGACCGGCTGAACGCCATCGGCGCCCATTCGGCCCCGGCGCGCGCCGGGGCGATCCTGTCGGGCCTGG GGTTCTCGGCCGAGGCCCAGGCCCGCGCCGTCGGCGAATTCTCCGGCGGCTGGCGCATGCGCGTCGCCCTGGCCGCCGCC TTGTTTTCCCGCCCGGATCTGCTGCTGCTCGACGAACCGACCAACCACCTTGATCTGGAGGCCACCTTGTGGCTGGAAGG CTTCCTGGCGAATTACCCGGGAACCTTGCTGATCATCAGCCACGATCGCGACCTGCTCAACCGCGCCGTCGGCCGCATCA TCCATCTCGATAACGGCAAGCTTGTCGCCTATGCCGGTAATTTCGACCGCTTCGAGCGCACCCGCCGCGAGCGCATGGAG CACCAATCCAAGGCCTTCGTCCGCCAGACCGAAGAGCGCAAGCGCATCCAGGCCTTCGTCGATCGCTTCCGCGCCAAGGC GACCAAGGCCCGTCAGGCGCAAAGCCGCCTGAAGATGCTCGAACGCATGCAGCCGGTGGAAGCGGTGGTCGAAGACTCGA CCATTCCCTTCGATTTCCCCGATCCCGACCAATTGCCGCCGCCGATCGTCGCCTTCGATGACGTGGCGGCGGGCTATGAC GGTGTCGCCGTGCTGCGCGGCGTCACCCTGCGCCTGGATATGGAGGACCGCGTCGCCCTGCTCGGCGCCAACGGCAATGG CAAATCCACCCTGGCCAAGGTGCTGGCCGGGCGTCTGGCGCCGCTGTCGGGCGAGATCCGCATGCCATCAAAACTGCGCA TCGGTTATTTCGCCCAGCATCAGACCGACGAATTGCGCATGGGCGAAAGCCCGCTGCTCCACGGCCGGCGGCTGATGGGC GAGTTGTCCGACCAGAAGATTCGCGGCCATCTTGGCCGCTTCGGCTTTGGCGAGGACCGGGTCCATACCCCGGTGGCCAA TCTGTCGGGCGGAGAAAAGGCCCGGTTGCTGATCGCCCTGACCTGCCGCGAGGCCCCCCATCTGCTGATCCTCGACGAAC CGACCAACCATCTTGATATCGATTCGCGCGAATCGCTGATGCAGGCGCTCAATGTCTTCCAGGGCGCGGTGCTGCTGATC TCCCATGATCCGCGACTGGTGGAAATGGTCGCCGACCGCCTGTGGCTGGTCGATGGCGGCAAGGTCACGTCTTTCGAAGG CGATATGGACGATTACCGCAAGCTGCTGCTTGAACGGGCCCGCGACGCGCGGCGCGAAGCCTCCAGCGATAGCGCCAACG CCGGCGAAGCAGCGGCCGAGGGCGCCGCCACCTCGGCCAGCGCCCGCCAGGATCGCCGCCGCGCCGCCGCCGAAGCCCGG GTTCGTTTGGCGCCGCTGCGCCGGGTGGCCGAAAAGGCCGAAGCCCAGGTCGACAAGCTGACCACCGAAAAGGCCAAGAT CCAGGCCGCCCTGGCCGATCCCGCCCTTTATCGCGGACCGAAGGAAAAAGTCGCCCTGCTTCAGCAAGATCTTGGCCGGG TCGACCGCGCCCTGGCTGGCGCCGAGGACGCTTGGTTGAGCGCCCAGGAGGCCTTGGATTCGGCGACGGCGGCCGAACCG GCCCTGGCCGAGGGCTGA
Upstream 100 bases:
>100_bases GGATGCGCGCCGGCGCATCCGACTTTCTTAAAAAGACGCGCGGCGGCGCGTCCCTCTCTATAGAAACGCGCGGTGGCGCG TCGGTGTTTAGGATCGCCCC
Downstream 100 bases:
>100_bases GCGGGCTTTTTCCGCCGCCCAAAGCTTGGGCAGAAAGCCCCTGATAGGCAGGTCGCCGCCCGCCGTTTGGGCAGTCGTAA TTAGATAAGCGTACACGGCC
Product: ABC transporter protein
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 645; Mature: 645
Protein sequence:
>645_residues MLHIKSLTYRIGGRTLLDEATAHIPEGQRIGLIGRNGTGKTTLFRLILGELSGDGGSIAVRPRARVGQVAQEAPDGDTTL LDCVLAADAERASLLAALEGDTDPHHLGEIHDRLNAIGAHSAPARAGAILSGLGFSAEAQARAVGEFSGGWRMRVALAAA LFSRPDLLLLDEPTNHLDLEATLWLEGFLANYPGTLLIISHDRDLLNRAVGRIIHLDNGKLVAYAGNFDRFERTRRERME HQSKAFVRQTEERKRIQAFVDRFRAKATKARQAQSRLKMLERMQPVEAVVEDSTIPFDFPDPDQLPPPIVAFDDVAAGYD GVAVLRGVTLRLDMEDRVALLGANGNGKSTLAKVLAGRLAPLSGEIRMPSKLRIGYFAQHQTDELRMGESPLLHGRRLMG ELSDQKIRGHLGRFGFGEDRVHTPVANLSGGEKARLLIALTCREAPHLLILDEPTNHLDIDSRESLMQALNVFQGAVLLI SHDPRLVEMVADRLWLVDGGKVTSFEGDMDDYRKLLLERARDARREASSDSANAGEAAAEGAATSASARQDRRRAAAEAR VRLAPLRRVAEKAEAQVDKLTTEKAKIQAALADPALYRGPKEKVALLQQDLGRVDRALAGAEDAWLSAQEALDSATAAEP ALAEG
Sequences:
>Translated_645_residues MLHIKSLTYRIGGRTLLDEATAHIPEGQRIGLIGRNGTGKTTLFRLILGELSGDGGSIAVRPRARVGQVAQEAPDGDTTL LDCVLAADAERASLLAALEGDTDPHHLGEIHDRLNAIGAHSAPARAGAILSGLGFSAEAQARAVGEFSGGWRMRVALAAA LFSRPDLLLLDEPTNHLDLEATLWLEGFLANYPGTLLIISHDRDLLNRAVGRIIHLDNGKLVAYAGNFDRFERTRRERME HQSKAFVRQTEERKRIQAFVDRFRAKATKARQAQSRLKMLERMQPVEAVVEDSTIPFDFPDPDQLPPPIVAFDDVAAGYD GVAVLRGVTLRLDMEDRVALLGANGNGKSTLAKVLAGRLAPLSGEIRMPSKLRIGYFAQHQTDELRMGESPLLHGRRLMG ELSDQKIRGHLGRFGFGEDRVHTPVANLSGGEKARLLIALTCREAPHLLILDEPTNHLDIDSRESLMQALNVFQGAVLLI SHDPRLVEMVADRLWLVDGGKVTSFEGDMDDYRKLLLERARDARREASSDSANAGEAAAEGAATSASARQDRRRAAAEAR VRLAPLRRVAEKAEAQVDKLTTEKAKIQAALADPALYRGPKEKVALLQQDLGRVDRALAGAEDAWLSAQEALDSATAAEP ALAEG >Mature_645_residues MLHIKSLTYRIGGRTLLDEATAHIPEGQRIGLIGRNGTGKTTLFRLILGELSGDGGSIAVRPRARVGQVAQEAPDGDTTL LDCVLAADAERASLLAALEGDTDPHHLGEIHDRLNAIGAHSAPARAGAILSGLGFSAEAQARAVGEFSGGWRMRVALAAA LFSRPDLLLLDEPTNHLDLEATLWLEGFLANYPGTLLIISHDRDLLNRAVGRIIHLDNGKLVAYAGNFDRFERTRRERME HQSKAFVRQTEERKRIQAFVDRFRAKATKARQAQSRLKMLERMQPVEAVVEDSTIPFDFPDPDQLPPPIVAFDDVAAGYD GVAVLRGVTLRLDMEDRVALLGANGNGKSTLAKVLAGRLAPLSGEIRMPSKLRIGYFAQHQTDELRMGESPLLHGRRLMG ELSDQKIRGHLGRFGFGEDRVHTPVANLSGGEKARLLIALTCREAPHLLILDEPTNHLDIDSRESLMQALNVFQGAVLLI SHDPRLVEMVADRLWLVDGGKVTSFEGDMDDYRKLLLERARDARREASSDSANAGEAAAEGAATSASARQDRRRAAAEAR VRLAPLRRVAEKAEAQVDKLTTEKAKIQAALADPALYRGPKEKVALLQQDLGRVDRALAGAEDAWLSAQEALDSATAAEP ALAEG
Specific function: Unknown
COG id: COG0488
COG function: function code R; ATPase components of ABC transporters with duplicated ATPase domains
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 2 ABC transporter domains [H]
Homologues:
Organism=Homo sapiens, GI148612853, Length=534, Percent_Identity=41.7602996254682, Blast_Score=410, Evalue=1e-114, Organism=Homo sapiens, GI10947137, Length=545, Percent_Identity=38.5321100917431, Blast_Score=376, Evalue=1e-104, Organism=Homo sapiens, GI27881506, Length=545, Percent_Identity=38.5321100917431, Blast_Score=376, Evalue=1e-104, Organism=Homo sapiens, GI69354671, Length=544, Percent_Identity=38.2352941176471, Blast_Score=304, Evalue=2e-82, Organism=Homo sapiens, GI10947135, Length=544, Percent_Identity=38.2352941176471, Blast_Score=303, Evalue=2e-82, Organism=Homo sapiens, GI31657092, Length=155, Percent_Identity=31.6129032258064, Blast_Score=68, Evalue=2e-11, Organism=Escherichia coli, GI1789751, Length=638, Percent_Identity=44.8275862068966, Blast_Score=517, Evalue=1e-148, Organism=Escherichia coli, GI1787041, Length=523, Percent_Identity=34.4168260038241, Blast_Score=313, Evalue=3e-86, Organism=Escherichia coli, GI1787182, Length=632, Percent_Identity=30.379746835443, Blast_Score=258, Evalue=8e-70, Organism=Escherichia coli, GI2367384, Length=527, Percent_Identity=29.9810246679317, Blast_Score=201, Evalue=2e-52, Organism=Escherichia coli, GI1788165, Length=196, Percent_Identity=33.1632653061224, Blast_Score=84, Evalue=2e-17, Organism=Escherichia coli, GI1789891, Length=215, Percent_Identity=28.3720930232558, Blast_Score=73, Evalue=5e-14, Organism=Escherichia coli, GI87081834, Length=200, Percent_Identity=31, Blast_Score=69, Evalue=1e-12, Organism=Escherichia coli, GI1787089, Length=229, Percent_Identity=26.6375545851528, Blast_Score=67, Evalue=5e-12, Organism=Escherichia coli, GI1787792, Length=210, Percent_Identity=30, Blast_Score=66, Evalue=6e-12, Organism=Escherichia coli, GI1786398, Length=244, Percent_Identity=26.6393442622951, Blast_Score=66, Evalue=6e-12, Organism=Escherichia coli, GI1786319, Length=203, Percent_Identity=27.5862068965517, Blast_Score=64, Evalue=2e-11, Organism=Escherichia coli, GI1787105, Length=209, Percent_Identity=30.1435406698565, Blast_Score=64, Evalue=3e-11, Organism=Escherichia coli, GI48994997, Length=225, Percent_Identity=27.1111111111111, Blast_Score=63, Evalue=5e-11, Organism=Escherichia coli, GI1787712, Length=227, Percent_Identity=28.6343612334802, Blast_Score=62, Evalue=8e-11, Organism=Caenorhabditis elegans, GI17553372, Length=530, Percent_Identity=40, Blast_Score=378, Evalue=1e-105, Organism=Caenorhabditis elegans, GI17555318, Length=530, Percent_Identity=37.3584905660377, Blast_Score=353, Evalue=1e-97, Organism=Caenorhabditis elegans, GI17559834, Length=540, Percent_Identity=35.5555555555556, Blast_Score=329, Evalue=3e-90, Organism=Saccharomyces cerevisiae, GI6321121, Length=552, Percent_Identity=38.9492753623188, Blast_Score=385, Evalue=1e-107, Organism=Saccharomyces cerevisiae, GI6320874, Length=529, Percent_Identity=34.593572778828, Blast_Score=332, Evalue=2e-91, Organism=Saccharomyces cerevisiae, GI6325030, Length=425, Percent_Identity=32.7058823529412, Blast_Score=170, Evalue=7e-43, Organism=Saccharomyces cerevisiae, GI6324314, Length=385, Percent_Identity=28.3116883116883, Blast_Score=141, Evalue=3e-34, Organism=Saccharomyces cerevisiae, GI6323278, Length=384, Percent_Identity=28.6458333333333, Blast_Score=136, Evalue=8e-33, Organism=Drosophila melanogaster, GI24666836, Length=527, Percent_Identity=40.2277039848197, Blast_Score=406, Evalue=1e-113, Organism=Drosophila melanogaster, GI24642252, Length=525, Percent_Identity=38.2857142857143, Blast_Score=364, Evalue=1e-101, Organism=Drosophila melanogaster, GI18859989, Length=525, Percent_Identity=38.2857142857143, Blast_Score=364, Evalue=1e-101, Organism=Drosophila melanogaster, GI24641342, Length=538, Percent_Identity=37.7323420074349, Blast_Score=343, Evalue=2e-94,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR003439 - InterPro: IPR017871 - InterPro: IPR003593 [H]
Pfam domain/function: PF00005 ABC_tran [H]
EC number: NA
Molecular weight: Translated: 70140; Mature: 70140
Theoretical pI: Translated: 6.67; Mature: 6.67
Prosite motif: PS00211 ABC_TRANSPORTER_1 ; PS50893 ABC_TRANSPORTER_2
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.3 %Cys (Translated Protein) 1.9 %Met (Translated Protein) 2.2 %Cys+Met (Translated Protein) 0.3 %Cys (Mature Protein) 1.9 %Met (Mature Protein) 2.2 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MLHIKSLTYRIGGRTLLDEATAHIPEGQRIGLIGRNGTGKTTLFRLILGELSGDGGSIAV CEEEEEEHEECCCCHHHHHHHHCCCCCCEEEEEECCCCCHHHHHHHHHHHHCCCCCEEEE RPRARVGQVAQEAPDGDTTLLDCVLAADAERASLLAALEGDTDPHHLGEIHDRLNAIGAH CCCHHHHHHHHHCCCCCHHHHHHHHHCCCHHHHHHHEECCCCCHHHHHHHHHHHHHCCCC SAPARAGAILSGLGFSAEAQARAVGEFSGGWRMRVALAAALFSRPDLLLLDEPTNHLDLE CCCCHHHHHHHCCCCCCCHHHHHHHCCCCCHHHHHHHHHHHHCCCCEEEEECCCCCCCCE ATLWLEGFLANYPGTLLIISHDRDLLNRAVGRIIHLDNGKLVAYAGNFDRFERTRRERME EHHHHHHHHHCCCCEEEEEECCHHHHHHHHCEEEEECCCEEEEEECCHHHHHHHHHHHHH HQSKAFVRQTEERKRIQAFVDRFRAKATKARQAQSRLKMLERMQPVEAVVEDSTIPFDFP HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCHHHHHHCCCCCCCCCC DPDQLPPPIVAFDDVAAGYDGVAVLRGVTLRLDMEDRVALLGANGNGKSTLAKVLAGRLA CCCCCCCCEEEECCHHCCCCCHHHHCCEEEEEECCCCEEEEECCCCCHHHHHHHHHHHCC PLSGEIRMPSKLRIGYFAQHQTDELRMGESPLLHGRRLMGELSDQKIRGHLGRFGFGEDR CCCCCCCCCCCEEEEEEECCCCCHHHCCCCCHHHHHHHHHHHHHHHHHHHHCCCCCCCCC VHTPVANLSGGEKARLLIALTCREAPHLLILDEPTNHLDIDSRESLMQALNVFQGAVLLI CCCCHHCCCCCCCEEEEEEEEECCCCEEEEEECCCCCCCCCCHHHHHHHHHHHCCEEEEE SHDPRLVEMVADRLWLVDGGKVTSFEGDMDDYRKLLLERARDARREASSDSANAGEAAAE ECCCHHHHHHHHHEEEEECCEEEECCCCHHHHHHHHHHHHHHHHHHCCCCCCCCCCHHHC GAATSASARQDRRRAAAEARVRLAPLRRVAEKAEAQVDKLTTEKAKIQAALADPALYRGP CCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHCCC KEKVALLQQDLGRVDRALAGAEDAWLSAQEALDSATAAEPALAEG HHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHCCCCCCCCC >Mature Secondary Structure MLHIKSLTYRIGGRTLLDEATAHIPEGQRIGLIGRNGTGKTTLFRLILGELSGDGGSIAV CEEEEEEHEECCCCHHHHHHHHCCCCCCEEEEEECCCCCHHHHHHHHHHHHCCCCCEEEE RPRARVGQVAQEAPDGDTTLLDCVLAADAERASLLAALEGDTDPHHLGEIHDRLNAIGAH CCCHHHHHHHHHCCCCCHHHHHHHHHCCCHHHHHHHEECCCCCHHHHHHHHHHHHHCCCC SAPARAGAILSGLGFSAEAQARAVGEFSGGWRMRVALAAALFSRPDLLLLDEPTNHLDLE CCCCHHHHHHHCCCCCCCHHHHHHHCCCCCHHHHHHHHHHHHCCCCEEEEECCCCCCCCE ATLWLEGFLANYPGTLLIISHDRDLLNRAVGRIIHLDNGKLVAYAGNFDRFERTRRERME EHHHHHHHHHCCCCEEEEEECCHHHHHHHHCEEEEECCCEEEEEECCHHHHHHHHHHHHH HQSKAFVRQTEERKRIQAFVDRFRAKATKARQAQSRLKMLERMQPVEAVVEDSTIPFDFP HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCHHHHHHCCCCCCCCCC DPDQLPPPIVAFDDVAAGYDGVAVLRGVTLRLDMEDRVALLGANGNGKSTLAKVLAGRLA CCCCCCCCEEEECCHHCCCCCHHHHCCEEEEEECCCCEEEEECCCCCHHHHHHHHHHHCC PLSGEIRMPSKLRIGYFAQHQTDELRMGESPLLHGRRLMGELSDQKIRGHLGRFGFGEDR CCCCCCCCCCCEEEEEEECCCCCHHHCCCCCHHHHHHHHHHHHHHHHHHHHCCCCCCCCC VHTPVANLSGGEKARLLIALTCREAPHLLILDEPTNHLDIDSRESLMQALNVFQGAVLLI CCCCHHCCCCCCCEEEEEEEEECCCCEEEEEECCCCCCCCCCHHHHHHHHHHHCCEEEEE SHDPRLVEMVADRLWLVDGGKVTSFEGDMDDYRKLLLERARDARREASSDSANAGEAAAE ECCCHHHHHHHHHEEEEECCEEEECCCCHHHHHHHHHHHHHHHHHHCCCCCCCCCCHHHC GAATSASARQDRRRAAAEARVRLAPLRRVAEKAEAQVDKLTTEKAKIQAALADPALYRGP CCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHCCC KEKVALLQQDLGRVDRALAGAEDAWLSAQEALDSATAAEPALAEG HHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHCCCCCCCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 11206551; 11258796 [H]