| Definition | Mycobacterium sp. MCS chromosome, complete genome. |
|---|---|
| Accession | NC_008146 |
| Length | 5,705,448 |
Click here to switch to the map view.
The map label for this gene is gbsB [H]
Identifier: 108797490
GI number: 108797490
Start: 564846
End: 566051
Strand: Direct
Name: gbsB [H]
Synonym: Mmcs_0510
Alternate gene names: 108797490
Gene position: 564846-566051 (Clockwise)
Preceding gene: 108797489
Following gene: 108797491
Centisome position: 9.9
GC content: 71.39
Gene sequence:
>1206_bases GTGACAATCGACAACATCTCGACCATCGCGCCGTTCGGCAACCACCTGCCGGTGCGCATCACCTTCGGCGAGGGCAGCGC TCACCGCCTGCCCGACCTGCTCCGCGACGCGGGTGCGCAGCGCGTGCTGGTGCTGACCGATCAGGGCATCGAGCACCACA ACCCGGCGGTCGCGGCTGTCCTGACGACCCTGTCCACCTCGGGCCTGACGGTCAGCCGACTGGACAAGGCCCCCGGTGAA CCCACGATCGAGATGGTCGACGCCGCCACCGCGAGGATGACCTCCGAATCGGTCGACGCGATCGTCGCCCTCGGCGGCGG CTCGGTGATCGACACCGCCAAGGCCGCCCGGTTGTGCCACCAGCAGGGCCTGACCTTCGGCGAGTTCCTCGACTCCGCGC GCACCTATCCGGCTCCCGCGGTCCCGCTGATCGCCGTGCCGACCACGGCGGGTACCGGATCGGAGGTGTCCGGCGGTGCG GTGGTGTCCGATCCCCAGGCCGGGCGCAAGGCCGGCATCGCCCACCCGAACATGCGGGCCCAGTACGCCGTGGTCGATCC CGTGCTGACGTGGAGCATGCCGCCGGTGATGACCGCCAACACCGGTATCGACGCGCTCGCACAGGCGATGGCCGCGGTCA TCGCCAAGGTGCGCACCCCGATCGGGGATGCCATCGCCCTGGAAGCCGTACGCCTGATGGGCCATTCGCTGCCCGCCGCC TACCGCGACGGCGCCGATGCCGCCGCCCGTGCCGGTATGGCCTGCGGCAGCATGATGGCCGGGCTGGCGATGAACATCTC CGACTGCGCGGCCGAACACTCGCTGGGGCAGGCCATCGGCGGCCTCTCCGGCGCCCCGCACGGCCTGACCATCGGCCTGG TGTTGGCCGAGACGCTGGAACGGGAGCGCCACCACGTGCCCGACCGGATGGAGCGCATCGCCGACGCGTGGGGACTGCCC GCCGACGGGACCGCGGACGGTAGCCGACTGGTCGGTGCGGTCCGCCGACTCCTGAGTGATCTGCAGTTCCCGGTGCTGAG TGATCTCGGCCTCGGCGCCGAGCATCTGGACCGCCTCACCGACCTGGCCCTGTCGGACTACTTCATCACCATGGCCCCGC AACCGTGGGACCGCGCCGAGGTGCACCAGGCGTTCGCCCGCGCGCTGGCCACCCGTGACCGCGGCCTCGTCACGGCCGCA GGTTAG
Upstream 100 bases:
>100_bases TTGATCTCGGCCGCAACGGCGCCGCTGTTCAACACCTCGACGCTGCCGGTGCAACCGTGATCCAGACACCATCCCTCTCG ACCACATTTGTTGGAGTGCA
Downstream 100 bases:
>100_bases GAAAACCATGTCCGCCCAGCAGGATTCGCCCGACCGGTTCGACGTCGTGATCGTCGGTGCCGGCTTCGCCGGCCTGTACA TGCTGCACCGCGTCCGCGCG
Product: iron-containing alcohol dehydrogenase
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 401; Mature: 400
Protein sequence:
>401_residues MTIDNISTIAPFGNHLPVRITFGEGSAHRLPDLLRDAGAQRVLVLTDQGIEHHNPAVAAVLTTLSTSGLTVSRLDKAPGE PTIEMVDAATARMTSESVDAIVALGGGSVIDTAKAARLCHQQGLTFGEFLDSARTYPAPAVPLIAVPTTAGTGSEVSGGA VVSDPQAGRKAGIAHPNMRAQYAVVDPVLTWSMPPVMTANTGIDALAQAMAAVIAKVRTPIGDAIALEAVRLMGHSLPAA YRDGADAAARAGMACGSMMAGLAMNISDCAAEHSLGQAIGGLSGAPHGLTIGLVLAETLERERHHVPDRMERIADAWGLP ADGTADGSRLVGAVRRLLSDLQFPVLSDLGLGAEHLDRLTDLALSDYFITMAPQPWDRAEVHQAFARALATRDRGLVTAA G
Sequences:
>Translated_401_residues MTIDNISTIAPFGNHLPVRITFGEGSAHRLPDLLRDAGAQRVLVLTDQGIEHHNPAVAAVLTTLSTSGLTVSRLDKAPGE PTIEMVDAATARMTSESVDAIVALGGGSVIDTAKAARLCHQQGLTFGEFLDSARTYPAPAVPLIAVPTTAGTGSEVSGGA VVSDPQAGRKAGIAHPNMRAQYAVVDPVLTWSMPPVMTANTGIDALAQAMAAVIAKVRTPIGDAIALEAVRLMGHSLPAA YRDGADAAARAGMACGSMMAGLAMNISDCAAEHSLGQAIGGLSGAPHGLTIGLVLAETLERERHHVPDRMERIADAWGLP ADGTADGSRLVGAVRRLLSDLQFPVLSDLGLGAEHLDRLTDLALSDYFITMAPQPWDRAEVHQAFARALATRDRGLVTAA G >Mature_400_residues TIDNISTIAPFGNHLPVRITFGEGSAHRLPDLLRDAGAQRVLVLTDQGIEHHNPAVAAVLTTLSTSGLTVSRLDKAPGEP TIEMVDAATARMTSESVDAIVALGGGSVIDTAKAARLCHQQGLTFGEFLDSARTYPAPAVPLIAVPTTAGTGSEVSGGAV VSDPQAGRKAGIAHPNMRAQYAVVDPVLTWSMPPVMTANTGIDALAQAMAAVIAKVRTPIGDAIALEAVRLMGHSLPAAY RDGADAAARAGMACGSMMAGLAMNISDCAAEHSLGQAIGGLSGAPHGLTIGLVLAETLERERHHVPDRMERIADAWGLPA DGTADGSRLVGAVRRLLSDLQFPVLSDLGLGAEHLDRLTDLALSDYFITMAPQPWDRAEVHQAFARALATRDRGLVTAAG
Specific function: Essential for the utilization of choline as a precursor [H]
COG id: COG1454
COG function: function code C; Alcohol dehydrogenase, class IV
Gene ontology:
Cell location: Integral Membrane Protein [C]
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the iron-containing alcohol dehydrogenase family [H]
Homologues:
Organism=Homo sapiens, GI133922590, Length=352, Percent_Identity=28.125, Blast_Score=94, Evalue=2e-19, Organism=Escherichia coli, GI87082107, Length=386, Percent_Identity=31.0880829015544, Blast_Score=151, Evalue=7e-38, Organism=Escherichia coli, GI48994951, Length=339, Percent_Identity=30.3834808259587, Blast_Score=140, Evalue=1e-34, Organism=Escherichia coli, GI1787493, Length=355, Percent_Identity=29.2957746478873, Blast_Score=130, Evalue=1e-31, Organism=Escherichia coli, GI1789163, Length=351, Percent_Identity=28.2051282051282, Blast_Score=124, Evalue=8e-30, Organism=Escherichia coli, GI1789386, Length=352, Percent_Identity=26.9886363636364, Blast_Score=96, Evalue=4e-21, Organism=Caenorhabditis elegans, GI17537053, Length=419, Percent_Identity=27.4463007159904, Blast_Score=122, Evalue=2e-28, Organism=Saccharomyces cerevisiae, GI6321181, Length=388, Percent_Identity=29.639175257732, Blast_Score=163, Evalue=5e-41, Organism=Drosophila melanogaster, GI24657991, Length=414, Percent_Identity=27.0531400966184, Blast_Score=93, Evalue=3e-19,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR001670 - InterPro: IPR018211 [H]
Pfam domain/function: PF00465 Fe-ADH [H]
EC number: =1.1.1.1 [H]
Molecular weight: Translated: 41533; Mature: 41402
Theoretical pI: Translated: 5.70; Mature: 5.70
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.7 %Cys (Translated Protein) 3.5 %Met (Translated Protein) 4.2 %Cys+Met (Translated Protein) 0.8 %Cys (Mature Protein) 3.2 %Met (Mature Protein) 4.0 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MTIDNISTIAPFGNHLPVRITFGEGSAHRLPDLLRDAGAQRVLVLTDQGIEHHNPAVAAV CCCCCCCHHCCCCCCCCEEEEECCCCHHHHHHHHHHCCCCEEEEEECCCCCCCCHHHHHH LTTLSTSGLTVSRLDKAPGEPTIEMVDAATARMTSESVDAIVALGGGSVIDTAKAARLCH HHHHCCCCCCHHHHHCCCCCCCHHHHHHHHHHHHHHCCCEEEEECCCCHHHHHHHHHHHH QQGLTFGEFLDSARTYPAPAVPLIAVPTTAGTGSEVSGGAVVSDPQAGRKAGIAHPNMRA HHCCCHHHHHHHHCCCCCCCCCEEEECCCCCCCCCCCCCEEECCCCCCCCCCCCCCCCCC QYAVVDPVLTWSMPPVMTANTGIDALAQAMAAVIAKVRTPIGDAIALEAVRLMGHSLPAA EEEEECHHHHCCCCCCEECCCCHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHCCCHH YRDGADAAARAGMACGSMMAGLAMNISDCAAEHSLGQAIGGLSGAPHGLTIGLVLAETLE HCCCCHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHH RERHHVPDRMERIADAWGLPADGTADGSRLVGAVRRLLSDLQFPVLSDLGLGAEHLDRLT HHHCCCHHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHCCCHHHHHCCCCHHHHHHHH DLALSDYFITMAPQPWDRAEVHQAFARALATRDRGLVTAAG HHHHHCEEEEECCCCCCHHHHHHHHHHHHHHCCCCCEEECC >Mature Secondary Structure TIDNISTIAPFGNHLPVRITFGEGSAHRLPDLLRDAGAQRVLVLTDQGIEHHNPAVAAV CCCCCCHHCCCCCCCCEEEEECCCCHHHHHHHHHHCCCCEEEEEECCCCCCCCHHHHHH LTTLSTSGLTVSRLDKAPGEPTIEMVDAATARMTSESVDAIVALGGGSVIDTAKAARLCH HHHHCCCCCCHHHHHCCCCCCCHHHHHHHHHHHHHHCCCEEEEECCCCHHHHHHHHHHHH QQGLTFGEFLDSARTYPAPAVPLIAVPTTAGTGSEVSGGAVVSDPQAGRKAGIAHPNMRA HHCCCHHHHHHHHCCCCCCCCCEEEECCCCCCCCCCCCCEEECCCCCCCCCCCCCCCCCC QYAVVDPVLTWSMPPVMTANTGIDALAQAMAAVIAKVRTPIGDAIALEAVRLMGHSLPAA EEEEECHHHHCCCCCCEECCCCHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHCCCHH YRDGADAAARAGMACGSMMAGLAMNISDCAAEHSLGQAIGGLSGAPHGLTIGLVLAETLE HCCCCHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHH RERHHVPDRMERIADAWGLPADGTADGSRLVGAVRRLLSDLQFPVLSDLGLGAEHLDRLT HHHCCCHHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHCCCHHHHHCCCCHHHHHHHH DLALSDYFITMAPQPWDRAEVHQAFARALATRDRGLVTAAG HHHHHCEEEEECCCCCCHHHHHHHHHHHHHHCCCCCEEECC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 6.0
TargetDB status: NA
Availability: NA
References: 8752328; 9384377 [H]