Definition Rhodospirillum rubrum ATCC 11170 chromosome, complete genome.
Accession NC_007643
Length 4,352,825

Click here to switch to the map view.

The map label for this gene is yheS [H]

Identifier: 83593505

GI number: 83593505

Start: 2519018

End: 2520955

Strand: Direct

Name: yheS [H]

Synonym: Rru_A2170

Alternate gene names: 83593505

Gene position: 2519018-2520955 (Clockwise)

Preceding gene: 83593503

Following gene: 83593506

Centisome position: 57.87

GC content: 67.03

Gene sequence:

>1938_bases
ATGCTGCACATCAAATCCCTGACCTACCGCATCGGCGGTCGCACCCTGCTTGACGAGGCCACCGCCCATATTCCCGAAGG
CCAGCGCATCGGACTGATCGGTCGCAACGGCACCGGCAAGACCACGCTGTTTCGCCTGATCCTTGGTGAATTGAGCGGCG
ATGGCGGATCGATCGCCGTCCGCCCGCGCGCCCGGGTCGGTCAGGTCGCCCAGGAGGCTCCCGACGGCGACACCACGCTG
CTTGACTGCGTGCTGGCCGCCGATGCCGAACGCGCCAGCCTGCTCGCCGCGCTTGAAGGCGACACCGATCCCCATCATCT
GGGCGAAATCCATGACCGGCTGAACGCCATCGGCGCCCATTCGGCCCCGGCGCGCGCCGGGGCGATCCTGTCGGGCCTGG
GGTTCTCGGCCGAGGCCCAGGCCCGCGCCGTCGGCGAATTCTCCGGCGGCTGGCGCATGCGCGTCGCCCTGGCCGCCGCC
TTGTTTTCCCGCCCGGATCTGCTGCTGCTCGACGAACCGACCAACCACCTTGATCTGGAGGCCACCTTGTGGCTGGAAGG
CTTCCTGGCGAATTACCCGGGAACCTTGCTGATCATCAGCCACGATCGCGACCTGCTCAACCGCGCCGTCGGCCGCATCA
TCCATCTCGATAACGGCAAGCTTGTCGCCTATGCCGGTAATTTCGACCGCTTCGAGCGCACCCGCCGCGAGCGCATGGAG
CACCAATCCAAGGCCTTCGTCCGCCAGACCGAAGAGCGCAAGCGCATCCAGGCCTTCGTCGATCGCTTCCGCGCCAAGGC
GACCAAGGCCCGTCAGGCGCAAAGCCGCCTGAAGATGCTCGAACGCATGCAGCCGGTGGAAGCGGTGGTCGAAGACTCGA
CCATTCCCTTCGATTTCCCCGATCCCGACCAATTGCCGCCGCCGATCGTCGCCTTCGATGACGTGGCGGCGGGCTATGAC
GGTGTCGCCGTGCTGCGCGGCGTCACCCTGCGCCTGGATATGGAGGACCGCGTCGCCCTGCTCGGCGCCAACGGCAATGG
CAAATCCACCCTGGCCAAGGTGCTGGCCGGGCGTCTGGCGCCGCTGTCGGGCGAGATCCGCATGCCATCAAAACTGCGCA
TCGGTTATTTCGCCCAGCATCAGACCGACGAATTGCGCATGGGCGAAAGCCCGCTGCTCCACGGCCGGCGGCTGATGGGC
GAGTTGTCCGACCAGAAGATTCGCGGCCATCTTGGCCGCTTCGGCTTTGGCGAGGACCGGGTCCATACCCCGGTGGCCAA
TCTGTCGGGCGGAGAAAAGGCCCGGTTGCTGATCGCCCTGACCTGCCGCGAGGCCCCCCATCTGCTGATCCTCGACGAAC
CGACCAACCATCTTGATATCGATTCGCGCGAATCGCTGATGCAGGCGCTCAATGTCTTCCAGGGCGCGGTGCTGCTGATC
TCCCATGATCCGCGACTGGTGGAAATGGTCGCCGACCGCCTGTGGCTGGTCGATGGCGGCAAGGTCACGTCTTTCGAAGG
CGATATGGACGATTACCGCAAGCTGCTGCTTGAACGGGCCCGCGACGCGCGGCGCGAAGCCTCCAGCGATAGCGCCAACG
CCGGCGAAGCAGCGGCCGAGGGCGCCGCCACCTCGGCCAGCGCCCGCCAGGATCGCCGCCGCGCCGCCGCCGAAGCCCGG
GTTCGTTTGGCGCCGCTGCGCCGGGTGGCCGAAAAGGCCGAAGCCCAGGTCGACAAGCTGACCACCGAAAAGGCCAAGAT
CCAGGCCGCCCTGGCCGATCCCGCCCTTTATCGCGGACCGAAGGAAAAAGTCGCCCTGCTTCAGCAAGATCTTGGCCGGG
TCGACCGCGCCCTGGCTGGCGCCGAGGACGCTTGGTTGAGCGCCCAGGAGGCCTTGGATTCGGCGACGGCGGCCGAACCG
GCCCTGGCCGAGGGCTGA

Upstream 100 bases:

>100_bases
GGATGCGCGCCGGCGCATCCGACTTTCTTAAAAAGACGCGCGGCGGCGCGTCCCTCTCTATAGAAACGCGCGGTGGCGCG
TCGGTGTTTAGGATCGCCCC

Downstream 100 bases:

>100_bases
GCGGGCTTTTTCCGCCGCCCAAAGCTTGGGCAGAAAGCCCCTGATAGGCAGGTCGCCGCCCGCCGTTTGGGCAGTCGTAA
TTAGATAAGCGTACACGGCC

Product: ABC transporter protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 645; Mature: 645

Protein sequence:

>645_residues
MLHIKSLTYRIGGRTLLDEATAHIPEGQRIGLIGRNGTGKTTLFRLILGELSGDGGSIAVRPRARVGQVAQEAPDGDTTL
LDCVLAADAERASLLAALEGDTDPHHLGEIHDRLNAIGAHSAPARAGAILSGLGFSAEAQARAVGEFSGGWRMRVALAAA
LFSRPDLLLLDEPTNHLDLEATLWLEGFLANYPGTLLIISHDRDLLNRAVGRIIHLDNGKLVAYAGNFDRFERTRRERME
HQSKAFVRQTEERKRIQAFVDRFRAKATKARQAQSRLKMLERMQPVEAVVEDSTIPFDFPDPDQLPPPIVAFDDVAAGYD
GVAVLRGVTLRLDMEDRVALLGANGNGKSTLAKVLAGRLAPLSGEIRMPSKLRIGYFAQHQTDELRMGESPLLHGRRLMG
ELSDQKIRGHLGRFGFGEDRVHTPVANLSGGEKARLLIALTCREAPHLLILDEPTNHLDIDSRESLMQALNVFQGAVLLI
SHDPRLVEMVADRLWLVDGGKVTSFEGDMDDYRKLLLERARDARREASSDSANAGEAAAEGAATSASARQDRRRAAAEAR
VRLAPLRRVAEKAEAQVDKLTTEKAKIQAALADPALYRGPKEKVALLQQDLGRVDRALAGAEDAWLSAQEALDSATAAEP
ALAEG

Sequences:

>Translated_645_residues
MLHIKSLTYRIGGRTLLDEATAHIPEGQRIGLIGRNGTGKTTLFRLILGELSGDGGSIAVRPRARVGQVAQEAPDGDTTL
LDCVLAADAERASLLAALEGDTDPHHLGEIHDRLNAIGAHSAPARAGAILSGLGFSAEAQARAVGEFSGGWRMRVALAAA
LFSRPDLLLLDEPTNHLDLEATLWLEGFLANYPGTLLIISHDRDLLNRAVGRIIHLDNGKLVAYAGNFDRFERTRRERME
HQSKAFVRQTEERKRIQAFVDRFRAKATKARQAQSRLKMLERMQPVEAVVEDSTIPFDFPDPDQLPPPIVAFDDVAAGYD
GVAVLRGVTLRLDMEDRVALLGANGNGKSTLAKVLAGRLAPLSGEIRMPSKLRIGYFAQHQTDELRMGESPLLHGRRLMG
ELSDQKIRGHLGRFGFGEDRVHTPVANLSGGEKARLLIALTCREAPHLLILDEPTNHLDIDSRESLMQALNVFQGAVLLI
SHDPRLVEMVADRLWLVDGGKVTSFEGDMDDYRKLLLERARDARREASSDSANAGEAAAEGAATSASARQDRRRAAAEAR
VRLAPLRRVAEKAEAQVDKLTTEKAKIQAALADPALYRGPKEKVALLQQDLGRVDRALAGAEDAWLSAQEALDSATAAEP
ALAEG
>Mature_645_residues
MLHIKSLTYRIGGRTLLDEATAHIPEGQRIGLIGRNGTGKTTLFRLILGELSGDGGSIAVRPRARVGQVAQEAPDGDTTL
LDCVLAADAERASLLAALEGDTDPHHLGEIHDRLNAIGAHSAPARAGAILSGLGFSAEAQARAVGEFSGGWRMRVALAAA
LFSRPDLLLLDEPTNHLDLEATLWLEGFLANYPGTLLIISHDRDLLNRAVGRIIHLDNGKLVAYAGNFDRFERTRRERME
HQSKAFVRQTEERKRIQAFVDRFRAKATKARQAQSRLKMLERMQPVEAVVEDSTIPFDFPDPDQLPPPIVAFDDVAAGYD
GVAVLRGVTLRLDMEDRVALLGANGNGKSTLAKVLAGRLAPLSGEIRMPSKLRIGYFAQHQTDELRMGESPLLHGRRLMG
ELSDQKIRGHLGRFGFGEDRVHTPVANLSGGEKARLLIALTCREAPHLLILDEPTNHLDIDSRESLMQALNVFQGAVLLI
SHDPRLVEMVADRLWLVDGGKVTSFEGDMDDYRKLLLERARDARREASSDSANAGEAAAEGAATSASARQDRRRAAAEAR
VRLAPLRRVAEKAEAQVDKLTTEKAKIQAALADPALYRGPKEKVALLQQDLGRVDRALAGAEDAWLSAQEALDSATAAEP
ALAEG

Specific function: Unknown

COG id: COG0488

COG function: function code R; ATPase components of ABC transporters with duplicated ATPase domains

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 2 ABC transporter domains [H]

Homologues:

Organism=Homo sapiens, GI148612853, Length=534, Percent_Identity=41.7602996254682, Blast_Score=410, Evalue=1e-114,
Organism=Homo sapiens, GI10947137, Length=545, Percent_Identity=38.5321100917431, Blast_Score=376, Evalue=1e-104,
Organism=Homo sapiens, GI27881506, Length=545, Percent_Identity=38.5321100917431, Blast_Score=376, Evalue=1e-104,
Organism=Homo sapiens, GI69354671, Length=544, Percent_Identity=38.2352941176471, Blast_Score=304, Evalue=2e-82,
Organism=Homo sapiens, GI10947135, Length=544, Percent_Identity=38.2352941176471, Blast_Score=303, Evalue=2e-82,
Organism=Homo sapiens, GI31657092, Length=155, Percent_Identity=31.6129032258064, Blast_Score=68, Evalue=2e-11,
Organism=Escherichia coli, GI1789751, Length=638, Percent_Identity=44.8275862068966, Blast_Score=517, Evalue=1e-148,
Organism=Escherichia coli, GI1787041, Length=523, Percent_Identity=34.4168260038241, Blast_Score=313, Evalue=3e-86,
Organism=Escherichia coli, GI1787182, Length=632, Percent_Identity=30.379746835443, Blast_Score=258, Evalue=8e-70,
Organism=Escherichia coli, GI2367384, Length=527, Percent_Identity=29.9810246679317, Blast_Score=201, Evalue=2e-52,
Organism=Escherichia coli, GI1788165, Length=196, Percent_Identity=33.1632653061224, Blast_Score=84, Evalue=2e-17,
Organism=Escherichia coli, GI1789891, Length=215, Percent_Identity=28.3720930232558, Blast_Score=73, Evalue=5e-14,
Organism=Escherichia coli, GI87081834, Length=200, Percent_Identity=31, Blast_Score=69, Evalue=1e-12,
Organism=Escherichia coli, GI1787089, Length=229, Percent_Identity=26.6375545851528, Blast_Score=67, Evalue=5e-12,
Organism=Escherichia coli, GI1787792, Length=210, Percent_Identity=30, Blast_Score=66, Evalue=6e-12,
Organism=Escherichia coli, GI1786398, Length=244, Percent_Identity=26.6393442622951, Blast_Score=66, Evalue=6e-12,
Organism=Escherichia coli, GI1786319, Length=203, Percent_Identity=27.5862068965517, Blast_Score=64, Evalue=2e-11,
Organism=Escherichia coli, GI1787105, Length=209, Percent_Identity=30.1435406698565, Blast_Score=64, Evalue=3e-11,
Organism=Escherichia coli, GI48994997, Length=225, Percent_Identity=27.1111111111111, Blast_Score=63, Evalue=5e-11,
Organism=Escherichia coli, GI1787712, Length=227, Percent_Identity=28.6343612334802, Blast_Score=62, Evalue=8e-11,
Organism=Caenorhabditis elegans, GI17553372, Length=530, Percent_Identity=40, Blast_Score=378, Evalue=1e-105,
Organism=Caenorhabditis elegans, GI17555318, Length=530, Percent_Identity=37.3584905660377, Blast_Score=353, Evalue=1e-97,
Organism=Caenorhabditis elegans, GI17559834, Length=540, Percent_Identity=35.5555555555556, Blast_Score=329, Evalue=3e-90,
Organism=Saccharomyces cerevisiae, GI6321121, Length=552, Percent_Identity=38.9492753623188, Blast_Score=385, Evalue=1e-107,
Organism=Saccharomyces cerevisiae, GI6320874, Length=529, Percent_Identity=34.593572778828, Blast_Score=332, Evalue=2e-91,
Organism=Saccharomyces cerevisiae, GI6325030, Length=425, Percent_Identity=32.7058823529412, Blast_Score=170, Evalue=7e-43,
Organism=Saccharomyces cerevisiae, GI6324314, Length=385, Percent_Identity=28.3116883116883, Blast_Score=141, Evalue=3e-34,
Organism=Saccharomyces cerevisiae, GI6323278, Length=384, Percent_Identity=28.6458333333333, Blast_Score=136, Evalue=8e-33,
Organism=Drosophila melanogaster, GI24666836, Length=527, Percent_Identity=40.2277039848197, Blast_Score=406, Evalue=1e-113,
Organism=Drosophila melanogaster, GI24642252, Length=525, Percent_Identity=38.2857142857143, Blast_Score=364, Evalue=1e-101,
Organism=Drosophila melanogaster, GI18859989, Length=525, Percent_Identity=38.2857142857143, Blast_Score=364, Evalue=1e-101,
Organism=Drosophila melanogaster, GI24641342, Length=538, Percent_Identity=37.7323420074349, Blast_Score=343, Evalue=2e-94,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR003439
- InterPro:   IPR017871
- InterPro:   IPR003593 [H]

Pfam domain/function: PF00005 ABC_tran [H]

EC number: NA

Molecular weight: Translated: 70140; Mature: 70140

Theoretical pI: Translated: 6.67; Mature: 6.67

Prosite motif: PS00211 ABC_TRANSPORTER_1 ; PS50893 ABC_TRANSPORTER_2

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.3 %Cys     (Translated Protein)
1.9 %Met     (Translated Protein)
2.2 %Cys+Met (Translated Protein)
0.3 %Cys     (Mature Protein)
1.9 %Met     (Mature Protein)
2.2 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MLHIKSLTYRIGGRTLLDEATAHIPEGQRIGLIGRNGTGKTTLFRLILGELSGDGGSIAV
CEEEEEEHEECCCCHHHHHHHHCCCCCCEEEEEECCCCCHHHHHHHHHHHHCCCCCEEEE
RPRARVGQVAQEAPDGDTTLLDCVLAADAERASLLAALEGDTDPHHLGEIHDRLNAIGAH
CCCHHHHHHHHHCCCCCHHHHHHHHHCCCHHHHHHHEECCCCCHHHHHHHHHHHHHCCCC
SAPARAGAILSGLGFSAEAQARAVGEFSGGWRMRVALAAALFSRPDLLLLDEPTNHLDLE
CCCCHHHHHHHCCCCCCCHHHHHHHCCCCCHHHHHHHHHHHHCCCCEEEEECCCCCCCCE
ATLWLEGFLANYPGTLLIISHDRDLLNRAVGRIIHLDNGKLVAYAGNFDRFERTRRERME
EHHHHHHHHHCCCCEEEEEECCHHHHHHHHCEEEEECCCEEEEEECCHHHHHHHHHHHHH
HQSKAFVRQTEERKRIQAFVDRFRAKATKARQAQSRLKMLERMQPVEAVVEDSTIPFDFP
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCHHHHHHCCCCCCCCCC
DPDQLPPPIVAFDDVAAGYDGVAVLRGVTLRLDMEDRVALLGANGNGKSTLAKVLAGRLA
CCCCCCCCEEEECCHHCCCCCHHHHCCEEEEEECCCCEEEEECCCCCHHHHHHHHHHHCC
PLSGEIRMPSKLRIGYFAQHQTDELRMGESPLLHGRRLMGELSDQKIRGHLGRFGFGEDR
CCCCCCCCCCCEEEEEEECCCCCHHHCCCCCHHHHHHHHHHHHHHHHHHHHCCCCCCCCC
VHTPVANLSGGEKARLLIALTCREAPHLLILDEPTNHLDIDSRESLMQALNVFQGAVLLI
CCCCHHCCCCCCCEEEEEEEEECCCCEEEEEECCCCCCCCCCHHHHHHHHHHHCCEEEEE
SHDPRLVEMVADRLWLVDGGKVTSFEGDMDDYRKLLLERARDARREASSDSANAGEAAAE
ECCCHHHHHHHHHEEEEECCEEEECCCCHHHHHHHHHHHHHHHHHHCCCCCCCCCCHHHC
GAATSASARQDRRRAAAEARVRLAPLRRVAEKAEAQVDKLTTEKAKIQAALADPALYRGP
CCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHCCC
KEKVALLQQDLGRVDRALAGAEDAWLSAQEALDSATAAEPALAEG
HHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHCCCCCCCCC
>Mature Secondary Structure
MLHIKSLTYRIGGRTLLDEATAHIPEGQRIGLIGRNGTGKTTLFRLILGELSGDGGSIAV
CEEEEEEHEECCCCHHHHHHHHCCCCCCEEEEEECCCCCHHHHHHHHHHHHCCCCCEEEE
RPRARVGQVAQEAPDGDTTLLDCVLAADAERASLLAALEGDTDPHHLGEIHDRLNAIGAH
CCCHHHHHHHHHCCCCCHHHHHHHHHCCCHHHHHHHEECCCCCHHHHHHHHHHHHHCCCC
SAPARAGAILSGLGFSAEAQARAVGEFSGGWRMRVALAAALFSRPDLLLLDEPTNHLDLE
CCCCHHHHHHHCCCCCCCHHHHHHHCCCCCHHHHHHHHHHHHCCCCEEEEECCCCCCCCE
ATLWLEGFLANYPGTLLIISHDRDLLNRAVGRIIHLDNGKLVAYAGNFDRFERTRRERME
EHHHHHHHHHCCCCEEEEEECCHHHHHHHHCEEEEECCCEEEEEECCHHHHHHHHHHHHH
HQSKAFVRQTEERKRIQAFVDRFRAKATKARQAQSRLKMLERMQPVEAVVEDSTIPFDFP
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCHHHHHHCCCCCCCCCC
DPDQLPPPIVAFDDVAAGYDGVAVLRGVTLRLDMEDRVALLGANGNGKSTLAKVLAGRLA
CCCCCCCCEEEECCHHCCCCCHHHHCCEEEEEECCCCEEEEECCCCCHHHHHHHHHHHCC
PLSGEIRMPSKLRIGYFAQHQTDELRMGESPLLHGRRLMGELSDQKIRGHLGRFGFGEDR
CCCCCCCCCCCEEEEEEECCCCCHHHCCCCCHHHHHHHHHHHHHHHHHHHHCCCCCCCCC
VHTPVANLSGGEKARLLIALTCREAPHLLILDEPTNHLDIDSRESLMQALNVFQGAVLLI
CCCCHHCCCCCCCEEEEEEEEECCCCEEEEEECCCCCCCCCCHHHHHHHHHHHCCEEEEE
SHDPRLVEMVADRLWLVDGGKVTSFEGDMDDYRKLLLERARDARREASSDSANAGEAAAE
ECCCHHHHHHHHHEEEEECCEEEECCCCHHHHHHHHHHHHHHHHHHCCCCCCCCCCHHHC
GAATSASARQDRRRAAAEARVRLAPLRRVAEKAEAQVDKLTTEKAKIQAALADPALYRGP
CCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHCCC
KEKVALLQQDLGRVDRALAGAEDAWLSAQEALDSATAAEPALAEG
HHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHCCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 11206551; 11258796 [H]