Definition Aquifex aeolicus VF5, complete genome.
Accession NC_000918
Length 1,551,335

Click here to switch to the map view.

The map label for this gene is guaB

Identifier: 15607007

GI number: 15607007

Start: 1424165

End: 1425637

Strand: Direct

Name: guaB

Synonym: aq_2023

Alternate gene names: 15607007

Gene position: 1424165-1425637 (Clockwise)

Preceding gene: 15607006

Following gene: 15607009

Centisome position: 91.8

GC content: 47.79

Gene sequence:

>1473_bases
ATGGTAGAAGTTGAAAAGAAGATAAAGGAAGGTTTAACCTTTGACGATGTCCTTTTAGTGCCCCAGTACTCTGAAGTTCT
GCCCCACGAAGTTGATGTGAGCACTTATCTGACAAAGAGGATTAAGCTGAACATCCCCATAGTCTCCGCCGCTATGGATA
CAGTAACGGAAGCACGTCTCGCTATTGCCCTTGCCAGAGAGGGAGGAATAGGTATTATCCACAGGAACCTCCCCATAAAG
AAACAGGCGGAGGAAGTTGAAAAGGTTAAGAAATCCGAGAGCGGTATGATAATAAACCCAGTAACTGTAAAACCGGACAC
ACGCGTAAAGGAAGCACTTGACATAATGGCAAAGTACAAGATATCTGGTGTTCCCGTAGTAGATGAAGAAAGGAAACTCA
TAGGTATTCTTACAAACAGAGACCTCAGGTTCATAAAGCCCGAAGACTACTCAAAACCTGTTTCCGAATTCATGACAAAG
GAGAACCTCATTACCGCACCTGAAGGTATAACTCTGGATGAGGCAGAAGAGATATTCAGGAAGTACAAAATTGAAAAACT
CCCGATAGTGGATAAGGAAGGAAAGATAAAAGGACTCATAACGATTAAGGACATAGTAAAGAGGAAAAAATACCCAAACG
CTTGCAAGGATGAACTTGGAAGGCTGAGGGTCGGGGCAGCCGTAGGAACTGGAGAGGAAACCCTTGACAGGGTAGCGGCT
CTCGTGGAAGCGGGAGTGGACGTCATAGTAGTAGATACGGCTCACGGGCACTCCAAGAGGGTTCTGGAAACCGTAGAAAA
GATTAAGGCAAACTTCCCGGAAGTGGACGTCATAGCGGGTAACGTGGCAACGGCTGAAGGAACAAAAGCCCTGATAGAGG
CAGGAGCGGATGCGGTAAAGGTGGGTGTTGGACCTGGTTCTATATGCACAACCCGTATAGTTGCAGGTGTGGGTGTTCCG
CAGCTCACCGCGATAATGGAAGCCGCAAGTGCTGCAAGGGAGTACGACATACCCATAATAGCTGACGGAGGGATAAGGTA
CTCCGGGGACATAGTAAAGGCTCTCGCAGCGGGTGCAAGTGCCGTAATGCTCGGGAACCTCCTTGCAGGAACGGAAGAAG
CCCCTGGGGAGACGATTTATTATCAGGGAAGGGCTTACAAGGTCTATAGAGGAATGGGCTCCTTAGGAGCTATGAGTTCA
AGACTATCTTCTGACAGGTACGGTCAAGAAAAAATGGAAAAGTTCGTACCGGAGGGAATTGAGGGGAGAGTTCCTTACAA
AGGAAAACTCGCGGATGTAGTTTACCAGCTCGTGGGTGGACTGCGTTCGGGAATGGGATACGTGGGTGCTAGAAATATTA
AGGAACTGCAGGAAAAGGCAAAGTTTGTAAGGATTACGTGGGCGGGATACAGAGAGTCACACGTTCACGACGTTCAAATT
ACGAGAGAAGCTCCCAACTACTGGGTCGATTAA

Upstream 100 bases:

>100_bases
CCGCTTTTGATATTGACACACTCATTAAGGACTTAAAGGAACAGCAGTAAAAATCCTTTCCTCCTTTTTCCTTTTAACCT
TTGAGTAATATAATATTTTT

Downstream 100 bases:

>100_bases
ATTCCCTTTTTTCCTTCTTTCTTCATAAAATTTCTTAAAACTTCAAGAACTTCCTCGTACTTCGTAAAGGTGTAAGGAAA
CTGCATCTGGAAGAACTTAA

Product: inosine monophosphate dehydrogenase

Products: NA

Alternate protein names: IMP dehydrogenase; IMPD; IMPDH

Number of amino acids: Translated: 490; Mature: 490

Protein sequence:

>490_residues
MVEVEKKIKEGLTFDDVLLVPQYSEVLPHEVDVSTYLTKRIKLNIPIVSAAMDTVTEARLAIALAREGGIGIIHRNLPIK
KQAEEVEKVKKSESGMIINPVTVKPDTRVKEALDIMAKYKISGVPVVDEERKLIGILTNRDLRFIKPEDYSKPVSEFMTK
ENLITAPEGITLDEAEEIFRKYKIEKLPIVDKEGKIKGLITIKDIVKRKKYPNACKDELGRLRVGAAVGTGEETLDRVAA
LVEAGVDVIVVDTAHGHSKRVLETVEKIKANFPEVDVIAGNVATAEGTKALIEAGADAVKVGVGPGSICTTRIVAGVGVP
QLTAIMEAASAAREYDIPIIADGGIRYSGDIVKALAAGASAVMLGNLLAGTEEAPGETIYYQGRAYKVYRGMGSLGAMSS
RLSSDRYGQEKMEKFVPEGIEGRVPYKGKLADVVYQLVGGLRSGMGYVGARNIKELQEKAKFVRITWAGYRESHVHDVQI
TREAPNYWVD

Sequences:

>Translated_490_residues
MVEVEKKIKEGLTFDDVLLVPQYSEVLPHEVDVSTYLTKRIKLNIPIVSAAMDTVTEARLAIALAREGGIGIIHRNLPIK
KQAEEVEKVKKSESGMIINPVTVKPDTRVKEALDIMAKYKISGVPVVDEERKLIGILTNRDLRFIKPEDYSKPVSEFMTK
ENLITAPEGITLDEAEEIFRKYKIEKLPIVDKEGKIKGLITIKDIVKRKKYPNACKDELGRLRVGAAVGTGEETLDRVAA
LVEAGVDVIVVDTAHGHSKRVLETVEKIKANFPEVDVIAGNVATAEGTKALIEAGADAVKVGVGPGSICTTRIVAGVGVP
QLTAIMEAASAAREYDIPIIADGGIRYSGDIVKALAAGASAVMLGNLLAGTEEAPGETIYYQGRAYKVYRGMGSLGAMSS
RLSSDRYGQEKMEKFVPEGIEGRVPYKGKLADVVYQLVGGLRSGMGYVGARNIKELQEKAKFVRITWAGYRESHVHDVQI
TREAPNYWVD
>Mature_490_residues
MVEVEKKIKEGLTFDDVLLVPQYSEVLPHEVDVSTYLTKRIKLNIPIVSAAMDTVTEARLAIALAREGGIGIIHRNLPIK
KQAEEVEKVKKSESGMIINPVTVKPDTRVKEALDIMAKYKISGVPVVDEERKLIGILTNRDLRFIKPEDYSKPVSEFMTK
ENLITAPEGITLDEAEEIFRKYKIEKLPIVDKEGKIKGLITIKDIVKRKKYPNACKDELGRLRVGAAVGTGEETLDRVAA
LVEAGVDVIVVDTAHGHSKRVLETVEKIKANFPEVDVIAGNVATAEGTKALIEAGADAVKVGVGPGSICTTRIVAGVGVP
QLTAIMEAASAAREYDIPIIADGGIRYSGDIVKALAAGASAVMLGNLLAGTEEAPGETIYYQGRAYKVYRGMGSLGAMSS
RLSSDRYGQEKMEKFVPEGIEGRVPYKGKLADVVYQLVGGLRSGMGYVGARNIKELQEKAKFVRITWAGYRESHVHDVQI
TREAPNYWVD

Specific function: GMP biosynthesis from IMP; first step. [C]

COG id: COG0516

COG function: function code F; IMP dehydrogenase/GMP reductase

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 2 CBS domains

Homologues:

Organism=Homo sapiens, GI66933016, Length=480, Percent_Identity=43.125, Blast_Score=378, Evalue=1e-105,
Organism=Homo sapiens, GI217035146, Length=480, Percent_Identity=42.9166666666667, Blast_Score=367, Evalue=1e-101,
Organism=Homo sapiens, GI34328930, Length=480, Percent_Identity=42.9166666666667, Blast_Score=365, Evalue=1e-101,
Organism=Homo sapiens, GI156616279, Length=480, Percent_Identity=42.9166666666667, Blast_Score=365, Evalue=1e-101,
Organism=Homo sapiens, GI34328928, Length=480, Percent_Identity=42.9166666666667, Blast_Score=365, Evalue=1e-101,
Organism=Homo sapiens, GI217035152, Length=474, Percent_Identity=42.8270042194093, Blast_Score=357, Evalue=1e-98,
Organism=Homo sapiens, GI217035148, Length=480, Percent_Identity=42.0833333333333, Blast_Score=354, Evalue=8e-98,
Organism=Homo sapiens, GI217035150, Length=480, Percent_Identity=40, Blast_Score=328, Evalue=6e-90,
Organism=Homo sapiens, GI156104880, Length=246, Percent_Identity=41.869918699187, Blast_Score=192, Evalue=9e-49,
Organism=Homo sapiens, GI50541956, Length=264, Percent_Identity=40.1515151515151, Blast_Score=189, Evalue=4e-48,
Organism=Homo sapiens, GI50541954, Length=264, Percent_Identity=40.1515151515151, Blast_Score=189, Evalue=4e-48,
Organism=Homo sapiens, GI50541952, Length=264, Percent_Identity=40.1515151515151, Blast_Score=189, Evalue=4e-48,
Organism=Homo sapiens, GI50541948, Length=264, Percent_Identity=40.1515151515151, Blast_Score=189, Evalue=4e-48,
Organism=Escherichia coli, GI1788855, Length=488, Percent_Identity=59.2213114754098, Blast_Score=515, Evalue=1e-147,
Organism=Escherichia coli, GI1786293, Length=255, Percent_Identity=36.4705882352941, Blast_Score=166, Evalue=4e-42,
Organism=Caenorhabditis elegans, GI71994385, Length=503, Percent_Identity=38.5685884691849, Blast_Score=307, Evalue=9e-84,
Organism=Caenorhabditis elegans, GI71994389, Length=425, Percent_Identity=41.6470588235294, Blast_Score=288, Evalue=7e-78,
Organism=Caenorhabditis elegans, GI17560440, Length=273, Percent_Identity=35.1648351648352, Blast_Score=177, Evalue=1e-44,
Organism=Saccharomyces cerevisiae, GI6322012, Length=490, Percent_Identity=39.5918367346939, Blast_Score=350, Evalue=2e-97,
Organism=Saccharomyces cerevisiae, GI6323585, Length=490, Percent_Identity=40.6122448979592, Blast_Score=347, Evalue=2e-96,
Organism=Saccharomyces cerevisiae, GI6323464, Length=490, Percent_Identity=40.6122448979592, Blast_Score=342, Evalue=1e-94,
Organism=Saccharomyces cerevisiae, GI6319352, Length=347, Percent_Identity=41.2103746397695, Blast_Score=267, Evalue=2e-72,
Organism=Saccharomyces cerevisiae, GI6319353, Length=116, Percent_Identity=39.6551724137931, Blast_Score=82, Evalue=2e-16,
Organism=Drosophila melanogaster, GI24641071, Length=482, Percent_Identity=42.9460580912863, Blast_Score=358, Evalue=6e-99,
Organism=Drosophila melanogaster, GI24641073, Length=482, Percent_Identity=42.9460580912863, Blast_Score=358, Evalue=6e-99,
Organism=Drosophila melanogaster, GI28571163, Length=440, Percent_Identity=42.7272727272727, Blast_Score=317, Evalue=8e-87,

Paralogues:

None

Copy number: 600 Molecules/Cell In: Growth Phase, Minimal Media (Based on E. coli). [C]

Swissprot (AC and ID): IMDH_AQUAE (O67820)

Other databases:

- EMBL:   AE000657
- PIR:   H70473
- RefSeq:   NP_214389.1
- ProteinModelPortal:   O67820
- SMR:   O67820
- GeneID:   1193717
- GenomeReviews:   AE000657_GR
- KEGG:   aae:aq_2023
- NMPDR:   fig|224324.1.peg.1404
- HOGENOM:   HBG298985
- OMA:   CVGLITV
- PhylomeDB:   O67820
- ProtClustDB:   CLSK2299911
- BioCyc:   AAEO224324:AQ_2023-MONOMER
- BRENDA:   1.1.1.205
- InterPro:   IPR013785
- InterPro:   IPR000644
- InterPro:   IPR005990
- InterPro:   IPR018529
- InterPro:   IPR015875
- InterPro:   IPR001093
- Gene3D:   G3DSA:3.20.20.70
- PIRSF:   PIRSF000130
- SMART:   SM00116
- TIGRFAMs:   TIGR01302

Pfam domain/function: PF00571 CBS; PF00478 IMPDH

EC number: =1.1.1.205

Molecular weight: Translated: 53402; Mature: 53402

Theoretical pI: Translated: 7.63; Mature: 7.63

Prosite motif: PS51371 CBS; PS00487 IMP_DH_GMP_RED

Important sites: ACT_SITE 309-309 BINDING 342-342 BINDING 389-389

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.4 %Cys     (Translated Protein)
2.2 %Met     (Translated Protein)
2.7 %Cys+Met (Translated Protein)
0.4 %Cys     (Mature Protein)
2.2 %Met     (Mature Protein)
2.7 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MVEVEKKIKEGLTFDDVLLVPQYSEVLPHEVDVSTYLTKRIKLNIPIVSAAMDTVTEARL
CCCCHHHHHCCCCCCCEEECCCHHHHCCCCCCHHHHEEEEEEEECCCHHHHHHHHHHHHH
AIALAREGGIGIIHRNLPIKKQAEEVEKVKKSESGMIINPVTVKPDTRVKEALDIMAKYK
EEEEECCCCEEEEECCCCCHHHHHHHHHHHHCCCCEEEEEEEECCCHHHHHHHHHHHHHC
ISGVPVVDEERKLIGILTNRDLRFIKPEDYSKPVSEFMTKENLITAPEGITLDEAEEIFR
CCCCCEECCCCCEEEEEECCCEEEECCCCCCHHHHHHHHHCCCEECCCCCCHHHHHHHHH
KYKIEKLPIVDKEGKIKGLITIKDIVKRKKYPNACKDELGRLRVGAAVGTGEETLDRVAA
HHCCCCCCCCCCCCCEEEEEEHHHHHHHCCCCCHHHHHHCCEEEEEEECCCHHHHHHHHH
LVEAGVDVIVVDTAHGHSKRVLETVEKIKANFPEVDVIAGNVATAEGTKALIEAGADAVK
HHHCCCCEEEEECCCCCHHHHHHHHHHHHCCCCCEEEEECCEECCCCHHHHHHCCCCEEE
VGVGPGSICTTRIVAGVGVPQLTAIMEAASAAREYDIPIIADGGIRYSGDIVKALAAGAS
ECCCCCHHHHHHHHHCCCCHHHHHHHHHHHHHHHCCCEEEECCCEEECHHHHHHHHCCCH
AVMLGNLLAGTEEAPGETIYYQGRAYKVYRGMGSLGAMSSRLSSDRYGQEKMEKFVPEGI
HHHHHHHHCCCCCCCCCEEEECCCEEEEECCCCCHHHHHHHHCCCCCCHHHHHHHCCCCC
EGRVPYKGKLADVVYQLVGGLRSGMGYVGARNIKELQEKAKFVRITWAGYRESHVHDVQI
CCCCCCCCHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHCCEEEEEEECCCCCCEEEEEE
TREAPNYWVD
EECCCCCCCC
>Mature Secondary Structure
MVEVEKKIKEGLTFDDVLLVPQYSEVLPHEVDVSTYLTKRIKLNIPIVSAAMDTVTEARL
CCCCHHHHHCCCCCCCEEECCCHHHHCCCCCCHHHHEEEEEEEECCCHHHHHHHHHHHHH
AIALAREGGIGIIHRNLPIKKQAEEVEKVKKSESGMIINPVTVKPDTRVKEALDIMAKYK
EEEEECCCCEEEEECCCCCHHHHHHHHHHHHCCCCEEEEEEEECCCHHHHHHHHHHHHHC
ISGVPVVDEERKLIGILTNRDLRFIKPEDYSKPVSEFMTKENLITAPEGITLDEAEEIFR
CCCCCEECCCCCEEEEEECCCEEEECCCCCCHHHHHHHHHCCCEECCCCCCHHHHHHHHH
KYKIEKLPIVDKEGKIKGLITIKDIVKRKKYPNACKDELGRLRVGAAVGTGEETLDRVAA
HHCCCCCCCCCCCCCEEEEEEHHHHHHHCCCCCHHHHHHCCEEEEEEECCCHHHHHHHHH
LVEAGVDVIVVDTAHGHSKRVLETVEKIKANFPEVDVIAGNVATAEGTKALIEAGADAVK
HHHCCCCEEEEECCCCCHHHHHHHHHHHHCCCCCEEEEECCEECCCCHHHHHHCCCCEEE
VGVGPGSICTTRIVAGVGVPQLTAIMEAASAAREYDIPIIADGGIRYSGDIVKALAAGAS
ECCCCCHHHHHHHHHCCCCHHHHHHHHHHHHHHHCCCEEEECCCEEECHHHHHHHHCCCH
AVMLGNLLAGTEEAPGETIYYQGRAYKVYRGMGSLGAMSSRLSSDRYGQEKMEKFVPEGI
HHHHHHHHCCCCCCCCCEEEECCCEEEEECCCCCHHHHHHHHCCCCCCHHHHHHHCCCCC
EGRVPYKGKLADVVYQLVGGLRSGMGYVGARNIKELQEKAKFVRITWAGYRESHVHDVQI
CCCCCCCCHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHCCEEEEEEECCCCCCEEEEEE
TREAPNYWVD
EECCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 9537320