| Definition | Rhizobium etli CFN 42 plasmid p42f, complete sequence. |
|---|---|
| Accession | NC_007766 |
| Length | 642,517 |
Click here to switch to the map view.
The map label for this gene is gbsB [H]
Identifier: 86361095
GI number: 86361095
Start: 413191
End: 414420
Strand: Reverse
Name: gbsB [H]
Synonym: RHE_PF00365
Alternate gene names: 86361095
Gene position: 414420-413191 (Counterclockwise)
Preceding gene: 86361096
Following gene: 86361094
Centisome position: 64.5
GC content: 65.12
Gene sequence:
>1230_bases ATGAGCCTGTTTGCCGCCTTGAGGCTGCCGCGGGAGATCCTGTTCGGTATCGGCCAGCGCCATGCGCTCGCGAGCGTCGC CAGCAGGACCGGCCGGCGCGCGCTCGTCTGCACGGACGCGCGTTTTGCCTCAACGCCCGCCTTCGCTGAAATGATCTCCG CCATCGAAGCCGCCGGCATCTCCGTACTGGTCCATGATCAGACGCTGCCGGACGTGCCGCGCGACACGGTCGCCGCTTGC GTTGAGGCCGCGCGTGGCTTTAAGCCCGATATGGTGATCGGCATCGGCGGTGGCAGCTGCCTCGACATGGCGAAATGCGC GTCGCTGTTGCTCTCTCATGGCGGCGCGCTTTCCGATTACTATGGTGAGTTCAAGGTGCCGGCACCGGTCCTGCCGATCA TTGCTGTGCCGACCACGGCAGGCACAGGCTCCGAGGTGACGCCGGTGGCGGTTGTATCCGATCCAGACCGCACCCTGAAG GTTGGCATTTCGAGCCCCTATCTCATCGCCGCCGCGGCGATATGTGATCCGGATCTCACCGTATCCTGCCCGCCTGGGCT CACGGCGGTTGCCGGTGCGGATGCCCTGACGCATGCCATCGAAGCCTTCACGGCGATGCGTCGCCCCGGCGACCCGGAAC TTGCGCAGCAGCATGTGTTTGTCGGCAAGAGCGACCTGTCCGACCAGTTCGCACTATATGCTATCCGGCTCCTCAGCCGG AGCCTTGAAAAGGCCTTCACCGACGGTTCGGACATCGAAGCGCGCTGCGATGTGATGATGGGTGCGCTCGCGGCGGGCTG TGCCTTCGGAACCGCAGGCACCGCTGCCGCCCATGCGGTGCAATACCCTGTCGGTGCTCTGACCCATACGCCGCACGGGC TCGGGGTGGCTACGATGCTGCCCTATGTAATGACATTCAACCGCCGCGTCGCTGCAGCGGAGATTGCCGCTGTCGGTAGG GCGCTCGGCCTCGACCCCAATGGCGTTGAGAACGACACGGCGGTTGCCGATTCCGCAATAACCGAGGTGAGCCGCCTCTT TGCCACGATCGGGATTGCGCCGACGCTCGCCAGACTCGGCCTACCTGAAGACCGGATCGACTGGGCGGCCGAGCAGGCAC TCGGCATCGGCCGGCTGATCAAAAATAATCCACGGCAGCTCGATTCAGCCGCCATGCGGGGCCTGTTGCGGGCAGCCTAT GACGGCGACCTTGCCGCTTCCGCCCTCTGA
Upstream 100 bases:
>100_bases CGGCTGCCCGCCGCAACGGTTTTGAGATCGACCAATGCCTCTGGGAAGACCTCAACGCGCTTTCCTCCTCCCGCATTCTG GCCTTCGAGGGACAAGGATC
Downstream 100 bases:
>100_bases ACCGGGAAATCATCATGAACATCAACAAGACTTCTCCAAATCTAGACTACGATCCCTTCGCGCTCAACTCGTTTTCCCGC GGCCTCTATATTGGCGGGGT
Product: putative alcohol dehydrogenase protein
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 409; Mature: 408
Protein sequence:
>409_residues MSLFAALRLPREILFGIGQRHALASVASRTGRRALVCTDARFASTPAFAEMISAIEAAGISVLVHDQTLPDVPRDTVAAC VEAARGFKPDMVIGIGGGSCLDMAKCASLLLSHGGALSDYYGEFKVPAPVLPIIAVPTTAGTGSEVTPVAVVSDPDRTLK VGISSPYLIAAAAICDPDLTVSCPPGLTAVAGADALTHAIEAFTAMRRPGDPELAQQHVFVGKSDLSDQFALYAIRLLSR SLEKAFTDGSDIEARCDVMMGALAAGCAFGTAGTAAAHAVQYPVGALTHTPHGLGVATMLPYVMTFNRRVAAAEIAAVGR ALGLDPNGVENDTAVADSAITEVSRLFATIGIAPTLARLGLPEDRIDWAAEQALGIGRLIKNNPRQLDSAAMRGLLRAAY DGDLAASAL
Sequences:
>Translated_409_residues MSLFAALRLPREILFGIGQRHALASVASRTGRRALVCTDARFASTPAFAEMISAIEAAGISVLVHDQTLPDVPRDTVAAC VEAARGFKPDMVIGIGGGSCLDMAKCASLLLSHGGALSDYYGEFKVPAPVLPIIAVPTTAGTGSEVTPVAVVSDPDRTLK VGISSPYLIAAAAICDPDLTVSCPPGLTAVAGADALTHAIEAFTAMRRPGDPELAQQHVFVGKSDLSDQFALYAIRLLSR SLEKAFTDGSDIEARCDVMMGALAAGCAFGTAGTAAAHAVQYPVGALTHTPHGLGVATMLPYVMTFNRRVAAAEIAAVGR ALGLDPNGVENDTAVADSAITEVSRLFATIGIAPTLARLGLPEDRIDWAAEQALGIGRLIKNNPRQLDSAAMRGLLRAAY DGDLAASAL >Mature_408_residues SLFAALRLPREILFGIGQRHALASVASRTGRRALVCTDARFASTPAFAEMISAIEAAGISVLVHDQTLPDVPRDTVAACV EAARGFKPDMVIGIGGGSCLDMAKCASLLLSHGGALSDYYGEFKVPAPVLPIIAVPTTAGTGSEVTPVAVVSDPDRTLKV GISSPYLIAAAAICDPDLTVSCPPGLTAVAGADALTHAIEAFTAMRRPGDPELAQQHVFVGKSDLSDQFALYAIRLLSRS LEKAFTDGSDIEARCDVMMGALAAGCAFGTAGTAAAHAVQYPVGALTHTPHGLGVATMLPYVMTFNRRVAAAEIAAVGRA LGLDPNGVENDTAVADSAITEVSRLFATIGIAPTLARLGLPEDRIDWAAEQALGIGRLIKNNPRQLDSAAMRGLLRAAYD GDLAASAL
Specific function: Essential for the utilization of choline as a precursor [H]
COG id: COG1454
COG function: function code C; Alcohol dehydrogenase, class IV
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the iron-containing alcohol dehydrogenase family [H]
Homologues:
Organism=Homo sapiens, GI133922590, Length=318, Percent_Identity=29.559748427673, Blast_Score=113, Evalue=3e-25, Organism=Escherichia coli, GI48994951, Length=342, Percent_Identity=32.1637426900585, Blast_Score=169, Evalue=4e-43, Organism=Escherichia coli, GI87082107, Length=323, Percent_Identity=36.5325077399381, Blast_Score=159, Evalue=3e-40, Organism=Escherichia coli, GI1789163, Length=377, Percent_Identity=29.1777188328912, Blast_Score=144, Evalue=8e-36, Organism=Escherichia coli, GI1787493, Length=431, Percent_Identity=30.3944315545244, Blast_Score=136, Evalue=3e-33, Organism=Escherichia coli, GI1789386, Length=364, Percent_Identity=23.0769230769231, Blast_Score=72, Evalue=7e-14, Organism=Caenorhabditis elegans, GI17537053, Length=358, Percent_Identity=29.0502793296089, Blast_Score=135, Evalue=3e-32, Organism=Saccharomyces cerevisiae, GI6321181, Length=407, Percent_Identity=29.7297297297297, Blast_Score=170, Evalue=3e-43, Organism=Drosophila melanogaster, GI24657991, Length=404, Percent_Identity=30.1980198019802, Blast_Score=130, Evalue=2e-30,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR001670 - InterPro: IPR018211 [H]
Pfam domain/function: PF00465 Fe-ADH [H]
EC number: =1.1.1.1 [H]
Molecular weight: Translated: 42228; Mature: 42097
Theoretical pI: Translated: 5.39; Mature: 5.39
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
2.0 %Cys (Translated Protein) 2.4 %Met (Translated Protein) 4.4 %Cys+Met (Translated Protein) 2.0 %Cys (Mature Protein) 2.2 %Met (Mature Protein) 4.2 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MSLFAALRLPREILFGIGQRHALASVASRTGRRALVCTDARFASTPAFAEMISAIEAAGI CCHHHHHHCCHHHHHHCCCHHHHHHHHHHCCCEEEEEECCCCCCCHHHHHHHHHHHHCCC SVLVHDQTLPDVPRDTVAACVEAARGFKPDMVIGIGGGSCLDMAKCASLLLSHGGALSDY EEEEECCCCCCCCHHHHHHHHHHHCCCCCCEEEECCCCCHHHHHHHHHHHHHCCCCHHHH YGEFKVPAPVLPIIAVPTTAGTGSEVTPVAVVSDPDRTLKVGISSPYLIAAAAICDPDLT CCCCCCCCCCCCEEEECCCCCCCCCCCEEEEECCCCCEEEEECCCCHHHHHHHHCCCCCE VSCPPGLTAVAGADALTHAIEAFTAMRRPGDPELAQQHVFVGKSDLSDQFALYAIRLLSR EECCCCCHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHEECCCCCCCHHHHHHHHHHHHH SLEKAFTDGSDIEARCDVMMGALAAGCAFGTAGTAAAHAVQYPVGALTHTPHGLGVATML HHHHHHCCCCCCHHHHHHHHHHHHHHHHCCCCCHHHHHHHHCCCHHHCCCCCCCCHHHHH PYVMTFNRRVAAAEIAAVGRALGLDPNGVENDTAVADSAITEVSRLFATIGIAPTLARLG HHHHHHCCHHHHHHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHCC LPEDRIDWAAEQALGIGRLIKNNPRQLDSAAMRGLLRAAYDGDLAASAL CCHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHCCCCHHHCCC >Mature Secondary Structure SLFAALRLPREILFGIGQRHALASVASRTGRRALVCTDARFASTPAFAEMISAIEAAGI CHHHHHHCCHHHHHHCCCHHHHHHHHHHCCCEEEEEECCCCCCCHHHHHHHHHHHHCCC SVLVHDQTLPDVPRDTVAACVEAARGFKPDMVIGIGGGSCLDMAKCASLLLSHGGALSDY EEEEECCCCCCCCHHHHHHHHHHHCCCCCCEEEECCCCCHHHHHHHHHHHHHCCCCHHHH YGEFKVPAPVLPIIAVPTTAGTGSEVTPVAVVSDPDRTLKVGISSPYLIAAAAICDPDLT CCCCCCCCCCCCEEEECCCCCCCCCCCEEEEECCCCCEEEEECCCCHHHHHHHHCCCCCE VSCPPGLTAVAGADALTHAIEAFTAMRRPGDPELAQQHVFVGKSDLSDQFALYAIRLLSR EECCCCCHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHEECCCCCCCHHHHHHHHHHHHH SLEKAFTDGSDIEARCDVMMGALAAGCAFGTAGTAAAHAVQYPVGALTHTPHGLGVATML HHHHHHCCCCCCHHHHHHHHHHHHHHHHCCCCCHHHHHHHHCCCHHHCCCCCCCCHHHHH PYVMTFNRRVAAAEIAAVGRALGLDPNGVENDTAVADSAITEVSRLFATIGIAPTLARLG HHHHHHCCHHHHHHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHCC LPEDRIDWAAEQALGIGRLIKNNPRQLDSAAMRGLLRAAYDGDLAASAL CCHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHCCCCHHHCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 8752328; 9384377 [H]