| Definition | Mycobacterium sp. MCS chromosome, complete genome. |
|---|---|
| Accession | NC_008146 |
| Length | 5,705,448 |
Click here to switch to the map view.
The map label for this gene is guaB [H]
Identifier: 108798138
GI number: 108798138
Start: 1262226
End: 1263779
Strand: Direct
Name: guaB [H]
Synonym: Mmcs_1167
Alternate gene names: 108798138
Gene position: 1262226-1263779 (Clockwise)
Preceding gene: 108798136
Following gene: 108798139
Centisome position: 22.12
GC content: 69.69
Gene sequence:
>1554_bases ATGTCGATCGCTGAACGCAGCGTTCCCATCGCCGTACCGGTGCCGACCGGCGGCGACGATCCGACGAAGGTGGCCATGCT CGGGCTGACCTTCGACGACGTCCTGCTGCTGCCCGCCGCCTCCGACGTCATACCCGCGACGGCCGACACCTCGAGCCAGC TGACCAAGCGCATCCGGCTGCGGGTGCCGCTGGTCAGCTCGGCGATGGACACGGTCACCGAATCCCGGATGGCCATCGCG ATGGCCCGGGCCGGCGGCATGGGTGTGCTGCACCGCAACCTGCCCGTGGCCGAACAGGCCGGTCAGGTCGAAACCGTCAA ACGGTCCGAGGCCGGGATGGTCACCGACCCGGTGACCTGCTCACCGGACAACACGCTGGCCGAAGTCGACGCGATGTGCG CGCGGTTCCGCATCTCCGGGCTGCCGGTCGTGGATGAGCGCGGCTCCCTCGTCGGCATCATCACCAACCGCGACATGCGC TTCGAGGTCGACCAGTCCAAACCGGTCTCCGAGGTGATGACCAAGGCGCCCTTGATCACGGCGCAGGAAGGTGTGTCGGC CGAGGCCGCGCTCGGCCTGCTGCGCCGGCACAAGATCGAGAAGCTGCCGATCGTCGACGGGCACGGCAAGCTCACCGGGC TGATCACCGTCAAGGACTTCGTCAAGACCGAACAGTTCCCGCTGGCGACCAAGGATTCCGACGGCAGGCTGCTCGTCGGC GCCGCGGTCGGCGTCGGCGACGACGCGTGGAACCGCGCGATGACGCTGGCCGACGCCGGCGTCGACGTGCTGATCGTCGA CACCGCCCACGCCCACAACCGGTCGGTGCTCGAGATGGTGCACCGCATCAAGACCGTGCTCGGTGACCGCGTCGAGGTCG TCGGCGGCAACGTCGCCACCCGCGCCGGGGCCGCCGCACTCGTCGAAGCCGGCGCGGACGCGGTGAAGGTCGGTGTCGGC CCGGGGTCGATCTGCACCACGCGGGTCGTCGCGGGCGTCGGGGCGCCACAGATCACCGCGATCCTCGAATCGGTCGCCGC GTGCGCCCCGGCCGGTGTGCCGGTGATCGCCGACGGCGGCCTGCAGTACTCGGGGGACATCGCCAAGGCGCTGGCCGCGG GCGCGTCGACGGCCATGCTGGGTTCGCTGCTCGCGGGCACCGCAGAGGCGCCGGGCGAGCTGATCTTCGTCAACGGCAAG CAGTTCAAGAGCTACCGCGGCATGGGATCGCTCGGTGCGATGCAGGGCCGCGGCGCGACAGGCAACCTCCGGGGCTCCTT CTCGAAGGACCGCTACTTCCAGGACGACGTGCTCTCCGAGGACAAGCTGGTACCCGAGGGCATCGAGGGCCGGGTGCCGT TCCGCGGTCCGCTGGCGCAGGTGATCCACCAGCTCACCGGCGGTCTGCGCGCGGCCATGGGTTACACCGGTTCACCCTCC ATCGAGGCGTTGCAGCAGGCGCAATTCGTGCAGATCACCGCGGCGGGGCTGAAGGAAAGCCACCCGCACGACATCACGAT GACCGTCGAAGCGCCCAACTACTACGCCCGCTGA
Upstream 100 bases:
>100_bases AGCCGTCGCCGGTGTGGCGACGTGGTGTGCGGGGCCGAGCGACCACGGCCGCAACCGATAGGATTGTGTATCCGCCCAAG TACCTATGGAGGGCCCGCCC
Downstream 100 bases:
>100_bases CGGACTGGGATACAGCACTGTGCGAGACATGGTCGAAATCGGTATGGGCCGCACCGCCCGCCGCACCTACGAACTCCACG ACATCAACATCGTGCCGTCG
Product: inosine 5'-monophosphate dehydrogenase
Products: NA
Alternate protein names: IMP dehydrogenase; IMPD; IMPDH [H]
Number of amino acids: Translated: 517; Mature: 516
Protein sequence:
>517_residues MSIAERSVPIAVPVPTGGDDPTKVAMLGLTFDDVLLLPAASDVIPATADTSSQLTKRIRLRVPLVSSAMDTVTESRMAIA MARAGGMGVLHRNLPVAEQAGQVETVKRSEAGMVTDPVTCSPDNTLAEVDAMCARFRISGLPVVDERGSLVGIITNRDMR FEVDQSKPVSEVMTKAPLITAQEGVSAEAALGLLRRHKIEKLPIVDGHGKLTGLITVKDFVKTEQFPLATKDSDGRLLVG AAVGVGDDAWNRAMTLADAGVDVLIVDTAHAHNRSVLEMVHRIKTVLGDRVEVVGGNVATRAGAAALVEAGADAVKVGVG PGSICTTRVVAGVGAPQITAILESVAACAPAGVPVIADGGLQYSGDIAKALAAGASTAMLGSLLAGTAEAPGELIFVNGK QFKSYRGMGSLGAMQGRGATGNLRGSFSKDRYFQDDVLSEDKLVPEGIEGRVPFRGPLAQVIHQLTGGLRAAMGYTGSPS IEALQQAQFVQITAAGLKESHPHDITMTVEAPNYYAR
Sequences:
>Translated_517_residues MSIAERSVPIAVPVPTGGDDPTKVAMLGLTFDDVLLLPAASDVIPATADTSSQLTKRIRLRVPLVSSAMDTVTESRMAIA MARAGGMGVLHRNLPVAEQAGQVETVKRSEAGMVTDPVTCSPDNTLAEVDAMCARFRISGLPVVDERGSLVGIITNRDMR FEVDQSKPVSEVMTKAPLITAQEGVSAEAALGLLRRHKIEKLPIVDGHGKLTGLITVKDFVKTEQFPLATKDSDGRLLVG AAVGVGDDAWNRAMTLADAGVDVLIVDTAHAHNRSVLEMVHRIKTVLGDRVEVVGGNVATRAGAAALVEAGADAVKVGVG PGSICTTRVVAGVGAPQITAILESVAACAPAGVPVIADGGLQYSGDIAKALAAGASTAMLGSLLAGTAEAPGELIFVNGK QFKSYRGMGSLGAMQGRGATGNLRGSFSKDRYFQDDVLSEDKLVPEGIEGRVPFRGPLAQVIHQLTGGLRAAMGYTGSPS IEALQQAQFVQITAAGLKESHPHDITMTVEAPNYYAR >Mature_516_residues SIAERSVPIAVPVPTGGDDPTKVAMLGLTFDDVLLLPAASDVIPATADTSSQLTKRIRLRVPLVSSAMDTVTESRMAIAM ARAGGMGVLHRNLPVAEQAGQVETVKRSEAGMVTDPVTCSPDNTLAEVDAMCARFRISGLPVVDERGSLVGIITNRDMRF EVDQSKPVSEVMTKAPLITAQEGVSAEAALGLLRRHKIEKLPIVDGHGKLTGLITVKDFVKTEQFPLATKDSDGRLLVGA AVGVGDDAWNRAMTLADAGVDVLIVDTAHAHNRSVLEMVHRIKTVLGDRVEVVGGNVATRAGAAALVEAGADAVKVGVGP GSICTTRVVAGVGAPQITAILESVAACAPAGVPVIADGGLQYSGDIAKALAAGASTAMLGSLLAGTAEAPGELIFVNGKQ FKSYRGMGSLGAMQGRGATGNLRGSFSKDRYFQDDVLSEDKLVPEGIEGRVPFRGPLAQVIHQLTGGLRAAMGYTGSPSI EALQQAQFVQITAAGLKESHPHDITMTVEAPNYYAR
Specific function: GMP biosynthesis from IMP; first step. [C]
COG id: COG0516
COG function: function code F; IMP dehydrogenase/GMP reductase
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 2 CBS domains [H]
Homologues:
Organism=Homo sapiens, GI217035146, Length=470, Percent_Identity=42.3404255319149, Blast_Score=336, Evalue=2e-92, Organism=Homo sapiens, GI156616279, Length=470, Percent_Identity=42.3404255319149, Blast_Score=335, Evalue=7e-92, Organism=Homo sapiens, GI34328930, Length=470, Percent_Identity=42.3404255319149, Blast_Score=335, Evalue=7e-92, Organism=Homo sapiens, GI34328928, Length=470, Percent_Identity=42.3404255319149, Blast_Score=335, Evalue=8e-92, Organism=Homo sapiens, GI66933016, Length=461, Percent_Identity=42.9501084598698, Blast_Score=329, Evalue=3e-90, Organism=Homo sapiens, GI217035152, Length=465, Percent_Identity=42.1505376344086, Blast_Score=327, Evalue=2e-89, Organism=Homo sapiens, GI217035148, Length=470, Percent_Identity=41.7021276595745, Blast_Score=325, Evalue=4e-89, Organism=Homo sapiens, GI217035150, Length=470, Percent_Identity=40.2127659574468, Blast_Score=305, Evalue=1e-82, Organism=Homo sapiens, GI50541956, Length=278, Percent_Identity=32.0143884892086, Blast_Score=137, Evalue=2e-32, Organism=Homo sapiens, GI50541954, Length=277, Percent_Identity=32.129963898917, Blast_Score=137, Evalue=2e-32, Organism=Homo sapiens, GI50541952, Length=277, Percent_Identity=32.129963898917, Blast_Score=137, Evalue=2e-32, Organism=Homo sapiens, GI50541948, Length=277, Percent_Identity=32.129963898917, Blast_Score=137, Evalue=2e-32, Organism=Homo sapiens, GI156104880, Length=270, Percent_Identity=31.1111111111111, Blast_Score=132, Evalue=8e-31, Organism=Escherichia coli, GI1788855, Length=494, Percent_Identity=53.8461538461538, Blast_Score=464, Evalue=1e-132, Organism=Escherichia coli, GI1786293, Length=285, Percent_Identity=29.8245614035088, Blast_Score=132, Evalue=5e-32, Organism=Caenorhabditis elegans, GI71994385, Length=482, Percent_Identity=35.0622406639004, Blast_Score=268, Evalue=7e-72, Organism=Caenorhabditis elegans, GI71994389, Length=434, Percent_Identity=36.6359447004608, Blast_Score=261, Evalue=6e-70, Organism=Caenorhabditis elegans, GI17560440, Length=269, Percent_Identity=33.8289962825279, Blast_Score=149, Evalue=3e-36, Organism=Saccharomyces cerevisiae, GI6323585, Length=463, Percent_Identity=41.9006479481641, Blast_Score=342, Evalue=7e-95, Organism=Saccharomyces cerevisiae, GI6323464, Length=463, Percent_Identity=41.2526997840173, Blast_Score=329, Evalue=7e-91, Organism=Saccharomyces cerevisiae, GI6322012, Length=488, Percent_Identity=38.7295081967213, Blast_Score=326, Evalue=5e-90, Organism=Saccharomyces cerevisiae, GI6319352, Length=339, Percent_Identity=38.3480825958702, Blast_Score=238, Evalue=2e-63, Organism=Saccharomyces cerevisiae, GI6319353, Length=120, Percent_Identity=42.5, Blast_Score=90, Evalue=1e-18, Organism=Drosophila melanogaster, GI24641071, Length=487, Percent_Identity=40.6570841889117, Blast_Score=330, Evalue=1e-90, Organism=Drosophila melanogaster, GI24641073, Length=487, Percent_Identity=40.6570841889117, Blast_Score=330, Evalue=1e-90, Organism=Drosophila melanogaster, GI28571163, Length=448, Percent_Identity=39.5089285714286, Blast_Score=290, Evalue=1e-78,
Paralogues:
None
Copy number: 600 Molecules/Cell In: Growth Phase, Minimal Media (Based on E. coli). [C]
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR013785 - InterPro: IPR000644 - InterPro: IPR005990 - InterPro: IPR018529 - InterPro: IPR015875 - InterPro: IPR001093 [H]
Pfam domain/function: PF00571 CBS; PF00478 IMPDH [H]
EC number: =1.1.1.205 [H]
Molecular weight: Translated: 53707; Mature: 53576
Theoretical pI: Translated: 6.07; Mature: 6.07
Prosite motif: PS00487 IMP_DH_GMP_RED
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.8 %Cys (Translated Protein) 3.3 %Met (Translated Protein) 4.1 %Cys+Met (Translated Protein) 0.8 %Cys (Mature Protein) 3.1 %Met (Mature Protein) 3.9 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MSIAERSVPIAVPVPTGGDDPTKVAMLGLTFDDVLLLPAASDVIPATADTSSQLTKRIRL CCCCCCCCCEEEECCCCCCCCCEEEEEECCHHHEEEECCCCCCCCCCCCCHHHHHHHHEE RVPLVSSAMDTVTESRMAIAMARAGGMGVLHRNLPVAEQAGQVETVKRSEAGMVTDPVTC ECCHHHHHHHHHHHHHHHEEECCCCCCEEEECCCCCHHHCCCHHHHHHCCCCCEECCEEC SPDNTLAEVDAMCARFRISGLPVVDERGSLVGIITNRDMRFEVDQSKPVSEVMTKAPLIT CCCCHHHHHHHHHHHHEECCCCEECCCCCEEEEEECCCEEEEECCCCCHHHHHHHCCCEE AQEGVSAEAALGLLRRHKIEKLPIVDGHGKLTGLITVKDFVKTEQFPLATKDSDGRLLVG ECCCCCHHHHHHHHHHHHHCCCCEECCCCCEEEEEEEHHHHCCCCCCCEECCCCCCEEEE AAVGVGDDAWNRAMTLADAGVDVLIVDTAHAHNRSVLEMVHRIKTVLGDRVEVVGGNVAT EEECCCCHHHHHEEEEECCCCEEEEEECCCCCCHHHHHHHHHHHHHHCCCEEEECCCHHH RAGAAALVEAGADAVKVGVGPGSICTTRVVAGVGAPQITAILESVAACAPAGVPVIADGG HHCHHHHHHCCCCEEEEECCCCCHHHHHHHHCCCCHHHHHHHHHHHHHCCCCCCEEECCC LQYSGDIAKALAAGASTAMLGSLLAGTAEAPGELIFVNGKQFKSYRGMGSLGAMQGRGAT CEECCHHHHHHHCCCHHHHHHHHHHCCCCCCCCEEEEECHHHHHHCCCCCCCCCCCCCCC GNLRGSFSKDRYFQDDVLSEDKLVPEGIEGRVPFRGPLAQVIHQLTGGLRAAMGYTGSPS CCCCCCCCCCCCCCHHHCCCCCCCCCCCCCCCCCCCHHHHHHHHHHCCHHHHCCCCCCCH IEALQQAQFVQITAAGLKESHPHDITMTVEAPNYYAR HHHHHHHHEEEEEECCCCCCCCCCEEEEEECCCCCCC >Mature Secondary Structure SIAERSVPIAVPVPTGGDDPTKVAMLGLTFDDVLLLPAASDVIPATADTSSQLTKRIRL CCCCCCCCEEEECCCCCCCCCEEEEEECCHHHEEEECCCCCCCCCCCCCHHHHHHHHEE RVPLVSSAMDTVTESRMAIAMARAGGMGVLHRNLPVAEQAGQVETVKRSEAGMVTDPVTC ECCHHHHHHHHHHHHHHHEEECCCCCCEEEECCCCCHHHCCCHHHHHHCCCCCEECCEEC SPDNTLAEVDAMCARFRISGLPVVDERGSLVGIITNRDMRFEVDQSKPVSEVMTKAPLIT CCCCHHHHHHHHHHHHEECCCCEECCCCCEEEEEECCCEEEEECCCCCHHHHHHHCCCEE AQEGVSAEAALGLLRRHKIEKLPIVDGHGKLTGLITVKDFVKTEQFPLATKDSDGRLLVG ECCCCCHHHHHHHHHHHHHCCCCEECCCCCEEEEEEEHHHHCCCCCCCEECCCCCCEEEE AAVGVGDDAWNRAMTLADAGVDVLIVDTAHAHNRSVLEMVHRIKTVLGDRVEVVGGNVAT EEECCCCHHHHHEEEEECCCCEEEEEECCCCCCHHHHHHHHHHHHHHCCCEEEECCCHHH RAGAAALVEAGADAVKVGVGPGSICTTRVVAGVGAPQITAILESVAACAPAGVPVIADGG HHCHHHHHHCCCCEEEEECCCCCHHHHHHHHCCCCHHHHHHHHHHHHHCCCCCCEEECCC LQYSGDIAKALAAGASTAMLGSLLAGTAEAPGELIFVNGKQFKSYRGMGSLGAMQGRGAT CEECCHHHHHHHCCCHHHHHHHHHHCCCCCCCCEEEEECHHHHHHCCCCCCCCCCCCCCC GNLRGSFSKDRYFQDDVLSEDKLVPEGIEGRVPFRGPLAQVIHQLTGGLRAAMGYTGSPS CCCCCCCCCCCCCCHHHCCCCCCCCCCCCCCCCCCCHHHHHHHHHHCCHHHHCCCCCCCH IEALQQAQFVQITAAGLKESHPHDITMTVEAPNYYAR HHHHHHHHEEEEEECCCCCCCCCCEEEEEECCCCCCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 12788972 [H]