| Definition | Chloroflexus sp. Y-400-fl chromosome, complete genome. |
|---|---|
| Accession | NC_012032 |
| Length | 5,268,950 |
Click here to switch to the map view.
The map label for this gene is guaA [H]
Identifier: 222524339
GI number: 222524339
Start: 1349733
End: 1351274
Strand: Reverse
Name: guaA [H]
Synonym: Chy400_1062
Alternate gene names: 222524339
Gene position: 1351274-1349733 (Counterclockwise)
Preceding gene: 222524341
Following gene: 222524338
Centisome position: 25.65
GC content: 59.47
Gene sequence:
>1542_bases ATGACCACACACAGCATACCGGTACTGGATTTTGGTTCGCAAACCGCTCAGCTCATCGTGCGGCGGTTGCGTGAGCTAGG CTACTACAGCGAGTTATTACCACACGACGCCCCCGAAGATCAGGTGCGAGCGCTGGCGCCGGTTGGTATTGTACTCAGCG GTGGCCCGGCAAGTGTCTACGAACCTGGCGCCCCTACGCTCCCGTCGTGGTTGCTGGAGAGTGATCTACCGGTCTTCGGT ATCTGCTACGGTATGCAACTAATCAGCCACACCCTGGGCGGGATTGTCACCCGGCCGGCTGGCCGCGAATACGGCCCGGC GATGATCACCATCACTCATCCGCACCCCCTCTTCGCCGACACCCCAACCGAGCAACCGGTCTGGATGAGCCACGGTGATC GGATCGAACAGTTGCCCACCGGCTTCACAGCGATTGCTGCCAATCCGGCAACCCCCTTCGCCGCCATTGCTGATGATCGG CGCAAGTGGTATGGTGTTCAGTTTCACCCCGAAGTGGTGCATACCGTCTATGGCCGAACCATCCTGACCAACTTTGCCCG TCTGTGTGGGGCACGCCCTGAATGGCAACCGAACAGCTTCGTCGCCGAAGCCATCGAGCGGGTCAAAGCCCAGGTCGGCG ATCACGGGCGCGTTATCTGTGCGTTGTCTGGCGGTGTCGACTCAGCCGTGGCCGCGCTCATTATTCATCGCGCTATCGGC GACCGCCTGACCTGCGTCTTTGTTGATAATGGTCTGTTACGGGCAGGCGAAGCGGAACAGGTGATCGCTACCTTCAGCGA GCATTTTCACGTGCCGCTGATTGCGGTTGATGCCCGCGAAGAGTTTATGACCGCTCTGAAAGGGGTGACTGACCCCGAAC AGAAGCGCAAAATTATCGGCGAGAAATTCATTCGGATCTTCGAGCGTGAAGCCCGCGCCCTCGCCGGGGTTGAATTCCTC GCCCAGGGCACTCTCTACCCCGACGTCATCGAGTCGACAGCCCCCGACCGCCCAAAGGCGGCGAAAATTAAAACCCACCA TAATGTTGGCGGTCTACCAGCCGACATGCAGCTCAAACTGGTCGAGCCGCTGCGCTATCTGTTCAAAGACGAAGTACGCG CCGCTGGCTTACAACTCGGGCTGCCCGAAACGTGGGTCTGGCGCCATCCCTTCCCTGGGCCGGGGCTGGCAGTGCGTATT ATCGGTGAAGTAACCTGGGAGCGCCTGGAGATACTGCGGCAGGCGGATAAGATCTTTTTGGAAGAGTTGCATGCCAGTGG CTATTATCGCGCCACCCAGCAGGCGTTTGCCGTCCTGCTACCGGTACAGAGTGTGGGGGTGATGGGTGATGGTCGTACCT ACGGCGTCACGATTGCCTTGCGCGCGATTACGACCGAAGACTACATGACCGCCGACTGGGCACGTCTGCCTTACGAGCTG CTGGCCCACGTGAGCAGCCGCATCGTCAACGAAGTCGAAGGGGTCAATCGGGTTGTGTACGATATTTCGTCGAAGCCACC GGCAACTATCGAATGGGAGTAG
Upstream 100 bases:
>100_bases GCGCGTTTTCGTTTGACATGTATTCCTGCCCGAAACAGCGTAAATCGCCACCTGACGCGGAGCAGTCGGCGGGAACATCT ATACCTGATGAGGACACCAC
Downstream 100 bases:
>100_bases TCAGCATCGGCAGCGCCGTGCTACAATAGAGCCATGCGCATACCACGAACAATCGCAATTGACGGCCAATCGGCCGCAGG GAAAAGTACATTAGGTGCAC
Product: GMP synthase
Products: NA
Alternate protein names: GMP synthetase; Glutamine amidotransferase [H]
Number of amino acids: Translated: 513; Mature: 512
Protein sequence:
>513_residues MTTHSIPVLDFGSQTAQLIVRRLRELGYYSELLPHDAPEDQVRALAPVGIVLSGGPASVYEPGAPTLPSWLLESDLPVFG ICYGMQLISHTLGGIVTRPAGREYGPAMITITHPHPLFADTPTEQPVWMSHGDRIEQLPTGFTAIAANPATPFAAIADDR RKWYGVQFHPEVVHTVYGRTILTNFARLCGARPEWQPNSFVAEAIERVKAQVGDHGRVICALSGGVDSAVAALIIHRAIG DRLTCVFVDNGLLRAGEAEQVIATFSEHFHVPLIAVDAREEFMTALKGVTDPEQKRKIIGEKFIRIFEREARALAGVEFL AQGTLYPDVIESTAPDRPKAAKIKTHHNVGGLPADMQLKLVEPLRYLFKDEVRAAGLQLGLPETWVWRHPFPGPGLAVRI IGEVTWERLEILRQADKIFLEELHASGYYRATQQAFAVLLPVQSVGVMGDGRTYGVTIALRAITTEDYMTADWARLPYEL LAHVSSRIVNEVEGVNRVVYDISSKPPATIEWE
Sequences:
>Translated_513_residues MTTHSIPVLDFGSQTAQLIVRRLRELGYYSELLPHDAPEDQVRALAPVGIVLSGGPASVYEPGAPTLPSWLLESDLPVFG ICYGMQLISHTLGGIVTRPAGREYGPAMITITHPHPLFADTPTEQPVWMSHGDRIEQLPTGFTAIAANPATPFAAIADDR RKWYGVQFHPEVVHTVYGRTILTNFARLCGARPEWQPNSFVAEAIERVKAQVGDHGRVICALSGGVDSAVAALIIHRAIG DRLTCVFVDNGLLRAGEAEQVIATFSEHFHVPLIAVDAREEFMTALKGVTDPEQKRKIIGEKFIRIFEREARALAGVEFL AQGTLYPDVIESTAPDRPKAAKIKTHHNVGGLPADMQLKLVEPLRYLFKDEVRAAGLQLGLPETWVWRHPFPGPGLAVRI IGEVTWERLEILRQADKIFLEELHASGYYRATQQAFAVLLPVQSVGVMGDGRTYGVTIALRAITTEDYMTADWARLPYEL LAHVSSRIVNEVEGVNRVVYDISSKPPATIEWE >Mature_512_residues TTHSIPVLDFGSQTAQLIVRRLRELGYYSELLPHDAPEDQVRALAPVGIVLSGGPASVYEPGAPTLPSWLLESDLPVFGI CYGMQLISHTLGGIVTRPAGREYGPAMITITHPHPLFADTPTEQPVWMSHGDRIEQLPTGFTAIAANPATPFAAIADDRR KWYGVQFHPEVVHTVYGRTILTNFARLCGARPEWQPNSFVAEAIERVKAQVGDHGRVICALSGGVDSAVAALIIHRAIGD RLTCVFVDNGLLRAGEAEQVIATFSEHFHVPLIAVDAREEFMTALKGVTDPEQKRKIIGEKFIRIFEREARALAGVEFLA QGTLYPDVIESTAPDRPKAAKIKTHHNVGGLPADMQLKLVEPLRYLFKDEVRAAGLQLGLPETWVWRHPFPGPGLAVRII GEVTWERLEILRQADKIFLEELHASGYYRATQQAFAVLLPVQSVGVMGDGRTYGVTIALRAITTEDYMTADWARLPYELL AHVSSRIVNEVEGVNRVVYDISSKPPATIEWE
Specific function: Catalyzes the synthesis of GMP from XMP [H]
COG id: COG0519
COG function: function code F; GMP synthase, PP-ATPase domain/subunit
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 1 GMP-binding domain [H]
Homologues:
Organism=Homo sapiens, GI4504035, Length=548, Percent_Identity=34.4890510948905, Blast_Score=266, Evalue=3e-71, Organism=Escherichia coli, GI1788854, Length=519, Percent_Identity=52.9865125240848, Blast_Score=565, Evalue=1e-162, Organism=Caenorhabditis elegans, GI133901714, Length=567, Percent_Identity=35.8024691358025, Blast_Score=285, Evalue=3e-77, Organism=Caenorhabditis elegans, GI71992717, Length=567, Percent_Identity=35.626102292769, Blast_Score=285, Evalue=3e-77, Organism=Caenorhabditis elegans, GI71992710, Length=567, Percent_Identity=35.626102292769, Blast_Score=285, Evalue=3e-77, Organism=Saccharomyces cerevisiae, GI6323873, Length=515, Percent_Identity=52.0388349514563, Blast_Score=535, Evalue=1e-153, Organism=Drosophila melanogaster, GI281365319, Length=551, Percent_Identity=34.3012704174229, Blast_Score=272, Evalue=5e-73,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR006220 - InterPro: IPR001317 - InterPro: IPR011702 - InterPro: IPR017926 - InterPro: IPR000991 - InterPro: IPR001674 - InterPro: IPR004739 - InterPro: IPR022955 - InterPro: IPR022310 - InterPro: IPR014729 [H]
Pfam domain/function: PF00117 GATase; PF00958 GMP_synt_C; PF02540 NAD_synthase [H]
EC number: =6.3.5.2 [H]
Molecular weight: Translated: 56573; Mature: 56441
Theoretical pI: Translated: 6.17; Mature: 6.17
Prosite motif: PS00442 GATASE_TYPE_I
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.8 %Cys (Translated Protein) 1.6 %Met (Translated Protein) 2.3 %Cys+Met (Translated Protein) 0.8 %Cys (Mature Protein) 1.4 %Met (Mature Protein) 2.1 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MTTHSIPVLDFGSQTAQLIVRRLRELGYYSELLPHDAPEDQVRALAPVGIVLSGGPASVY CCCCCCCEEECCCHHHHHHHHHHHHCCHHHHHCCCCCCHHHHHHHCCEEEEEECCCCCCC EPGAPTLPSWLLESDLPVFGICYGMQLISHTLGGIVTRPAGREYGPAMITITHPHPLFAD CCCCCCCHHHHHHCCCCHHHHHHHHHHHHHHHCCEEECCCCCCCCCEEEEEECCCCCCCC TPTEQPVWMSHGDRIEQLPTGFTAIAANPATPFAAIADDRRKWYGVQFHPEVVHTVYGRT CCCCCCEECCCCCHHHHCCCCCEEEECCCCCCHHHHHCCHHHEECCEECHHHHHHHHHHH ILTNFARLCGARPEWQPNSFVAEAIERVKAQVGDHGRVICALSGGVDSAVAALIIHRAIG HHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHCCCCCEEEEECCCHHHHHHHHHHHHHHC DRLTCVFVDNGLLRAGEAEQVIATFSEHFHVPLIAVDAREEFMTALKGVTDPEQKRKIIG CCEEEEEECCCCCCCCCHHHHHHHHHHCCCCEEEEECCHHHHHHHHCCCCCHHHHHHHHH EKFIRIFEREARALAGVEFLAQGTLYPDVIESTAPDRPKAAKIKTHHNVGGLPADMQLKL HHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHCCCCCCCCCCEEEECCCCCCCCCCCHHHH VEPLRYLFKDEVRAAGLQLGLPETWVWRHPFPGPGLAVRIIGEVTWERLEILRQADKIFL HHHHHHHHHHHHHHCCEECCCCCCEEECCCCCCCCCEEEEHHHHHHHHHHHHHHHHHHHH EELHASGYYRATQQAFAVLLPVQSVGVMGDGRTYGVTIALRAITTEDYMTADWARLPYEL HHHHCCCCHHHHHHHHHHHEEHHHHCEECCCCEEEEEEEEEEEECCCHHCCHHHHCCHHH LAHVSSRIVNEVEGVNRVVYDISSKPPATIEWE HHHHHHHHHHHHHHHHEEEEECCCCCCCEEECC >Mature Secondary Structure TTHSIPVLDFGSQTAQLIVRRLRELGYYSELLPHDAPEDQVRALAPVGIVLSGGPASVY CCCCCCEEECCCHHHHHHHHHHHHCCHHHHHCCCCCCHHHHHHHCCEEEEEECCCCCCC EPGAPTLPSWLLESDLPVFGICYGMQLISHTLGGIVTRPAGREYGPAMITITHPHPLFAD CCCCCCCHHHHHHCCCCHHHHHHHHHHHHHHHCCEEECCCCCCCCCEEEEEECCCCCCCC TPTEQPVWMSHGDRIEQLPTGFTAIAANPATPFAAIADDRRKWYGVQFHPEVVHTVYGRT CCCCCCEECCCCCHHHHCCCCCEEEECCCCCCHHHHHCCHHHEECCEECHHHHHHHHHHH ILTNFARLCGARPEWQPNSFVAEAIERVKAQVGDHGRVICALSGGVDSAVAALIIHRAIG HHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHCCCCCEEEEECCCHHHHHHHHHHHHHHC DRLTCVFVDNGLLRAGEAEQVIATFSEHFHVPLIAVDAREEFMTALKGVTDPEQKRKIIG CCEEEEEECCCCCCCCCHHHHHHHHHHCCCCEEEEECCHHHHHHHHCCCCCHHHHHHHHH EKFIRIFEREARALAGVEFLAQGTLYPDVIESTAPDRPKAAKIKTHHNVGGLPADMQLKL HHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHCCCCCCCCCCEEEECCCCCCCCCCCHHHH VEPLRYLFKDEVRAAGLQLGLPETWVWRHPFPGPGLAVRIIGEVTWERLEILRQADKIFL HHHHHHHHHHHHHHCCEECCCCCCEEECCCCCCCCCEEEEHHHHHHHHHHHHHHHHHHHH EELHASGYYRATQQAFAVLLPVQSVGVMGDGRTYGVTIALRAITTEDYMTADWARLPYEL HHHHCCCCHHHHHHHHHHHEEHHHHCEECCCCEEEEEEEEEEEECCCHHCCHHHHCCHHH LAHVSSRIVNEVEGVNRVVYDISSKPPATIEWE HHHHHHHHHHHHHHHHEEEEECCCCCCCEEECC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: NA