| Definition | Francisella tularensis subsp. tularensis WY96-3418, complete genome. |
|---|---|
| Accession | NC_009257 |
| Length | 1,898,476 |
Click here to switch to the map view.
The map label for this gene is purCD [H]
Identifier: 134302215
GI number: 134302215
Start: 1216722
End: 1219034
Strand: Reverse
Name: purCD [H]
Synonym: FTW_1285
Alternate gene names: 134302215
Gene position: 1219034-1216722 (Counterclockwise)
Preceding gene: 134302216
Following gene: 134302214
Centisome position: 64.21
GC content: 36.14
Gene sequence:
>2313_bases ATGCTTGATAAACAAATCATTGCTAATAATATAAAAAATGTTCTAAAATCAACAAATCTTGATATCAAGAATAAATATAT AGGTAAAGTAAGAGATATGTACTTTACTGATGACAAAAGTATTTTGATATCTACAGATAGACAATCTGCTTTTGATAGAT CTTTGGGTTTTATACCATTTAAGGGGCAAATCCTTGCACAATCATCAGTATGGTGGTTCAAAGAAACAGCACATATTGTC AAAAACCACTTTATAGACTCTCCAGATCCAAATGTTGTCATCGCGAGAAAGGCAAAAGTATTGCCAATTGAGTTTGTCGT TAGAGGTTATATAACTGGTTCAACTTCTACATCATTGTGGACACATTATAAAAACGGTAGCCGTGACTATTGTGGCAATA TCCTGCCAGAAGGTTTAAAAAAGAATCAAAAATTACCACAAAATATCCTTACACCAACTACCAAAGAGCAAGATCATGAT CGCCCAATTTCAGCTGAGGATATTGTCAAGGAAGGTTGGCTAACTCAGCAGCAGTGGGATTTTGCTTCACAAAAGGCTCT AGAACTTTTTGAGTTTGGACAAAAAAAAGCCTTAGAACATGGCTTAATTTTGGCGGATACTAAATATGAGTTTGGTATTG ATGAGCAAACTGGAGAGATTATTTTGATCGATGAGATCCATACTCCAGATAGCTCAAGATTTTGGCTAAAAGATAGCTAT GCTACAAGATTTGAAAATGGTGAAGAACCAGAGAATATTGATAAAGAATTTTTTAGATTATGGTTTGCAAAAAATTGTGA CCCATATAATGATGAAGTTTTACCACAAGCACCACAAGAGTTAGTTGTCGAATTATCTCAAAAATATATAGCCCTTTTTG AAATGATAACAGGGCAAAAGTTTGAAGTACCAAGAGATTTAGAAAATATAAATCAACGTATTGTTAAAAATGTTACAGAT TACTTAAATATGGAGAAGCCAGTGAATATTCTTCTAGTAGGATCAGGAAGTAGAGAGCATGCGATAGCAGAAGCAGTCAA AAGAAGCTCTATTGCAAATAAGCTTTTTTGTATAAGCACAGCGATTAACCCTGCGATAGATAAGATAACGCAAGGGTATC AAATCGCTGATATTTGTAATTGTGATGAAGTACTAGAGTATGCAAAATCACAAAGTATTGATATTGCGATTATCGGTCCT GAAGCACCACTTGAGGCTGGTCTAGCTGATGCACTTAAGACAGCAGCAATTGGCGTAGTTGGTCCAACCAAAAAGTTAGC ACAGCTTGAAACATCAAAAGGTTTCACTAGAGATCTGATCCGTGATTATGATATAGGCGCTAATCCTTTCTTTAGAAAGT TTAACTCGATGGATGGAGTCGAAGAGACTCTCAAAAAATATCAAAATCAATTTGTCATAAAAGCTGATGGTTTATGTGGT GGTAAAGGAGTGCTTGTTTGGGGCGATCATTTGCACAGCCTTGATGAGGCGATTAGACACTGTCAGTCATTGGTAGATGC TGGCAAAGAGTTTGTTATCGAGGAGAAGCTTGTTGGCCAGGAGTTCTCGCTGATATCATTTACTGATGGCAAAAATTTTA TCCATATGCCAGCAGTCCAAGATCATAAGCGTGCCCATGAAGGTGACAAAGGTCCTAATACCGGTGGTATGGGTACTTAT TCTGATGCTAATCATAGTTTACCGTTTTTATCAGCTGCTGATATCGAAAGAGCAAAACAAATAAATGAGAAAGTTGTCAG AGCTTTAGCTGATAAATTTGGTGAACCATATCAAGGTATCCTTTATGGTGGCTTTATGGCGACAAAAGATGATACTAAAG TGATCGAGTATAATGCACGTTTTGGTGATCCAGAAGCGATGAATCTACTTACACTGTTAGAGACAGATTTTGTTGAGATT GCTCAAGCTATTACACAGGGTAAACTTGATACGGTCAAAGCTAAGTTTAAAAATCAAGCAAGCGTATGTAAATATCTAGT ACCGCTTGGCTATCCAAACCAATCAGTTAAAAACTTTGAGATAGATATTTCACAATGCCCTGATAATGTCGAGCTTTTCT TAGGTGCTGTTGATTATAAAGATGGTAAGCTAATTGGTACAGGTTCTAGAGCTATAGCTGTACTTGGTTTAGGTGATACA ATAGCTGAAGCAGAGCAAAAAGCCGAAAATGCTGTCAAAAATATTTATGGTAAACTATTTCATCGTCCAGATATTGGTAC TAAAGAGCTTATCAATAAGCGTATCAAACACATGAATTTGTTGCGTGGTGATAAATATCAGGAGCTTAAATAA
Upstream 100 bases:
>100_bases ATCAATTTGACAAGATGCAAGAATTAGCTAAAAAACATACTAATACAAAACTATATCAAATTGGTAAAATCACAAATTCA GGAAAGGTAGAAATTATCTA
Downstream 100 bases:
>100_bases ATAATGTCTAAGCTAAATCTTGTTATATTAGGCTCTACGCGTGGGACTAATATGCAAGCTATAATAGATGCAATAGCAAA TAAGCAGCTAAATGCTCAGG
Product: fusion protein PurC/PurD
Products: NA
Alternate protein names: GARS; Glycinamide ribonucleotide synthetase; Phosphoribosylglycinamide synthetase [H]
Number of amino acids: Translated: 770; Mature: 770
Protein sequence:
>770_residues MLDKQIIANNIKNVLKSTNLDIKNKYIGKVRDMYFTDDKSILISTDRQSAFDRSLGFIPFKGQILAQSSVWWFKETAHIV KNHFIDSPDPNVVIARKAKVLPIEFVVRGYITGSTSTSLWTHYKNGSRDYCGNILPEGLKKNQKLPQNILTPTTKEQDHD RPISAEDIVKEGWLTQQQWDFASQKALELFEFGQKKALEHGLILADTKYEFGIDEQTGEIILIDEIHTPDSSRFWLKDSY ATRFENGEEPENIDKEFFRLWFAKNCDPYNDEVLPQAPQELVVELSQKYIALFEMITGQKFEVPRDLENINQRIVKNVTD YLNMEKPVNILLVGSGSREHAIAEAVKRSSIANKLFCISTAINPAIDKITQGYQIADICNCDEVLEYAKSQSIDIAIIGP EAPLEAGLADALKTAAIGVVGPTKKLAQLETSKGFTRDLIRDYDIGANPFFRKFNSMDGVEETLKKYQNQFVIKADGLCG GKGVLVWGDHLHSLDEAIRHCQSLVDAGKEFVIEEKLVGQEFSLISFTDGKNFIHMPAVQDHKRAHEGDKGPNTGGMGTY SDANHSLPFLSAADIERAKQINEKVVRALADKFGEPYQGILYGGFMATKDDTKVIEYNARFGDPEAMNLLTLLETDFVEI AQAITQGKLDTVKAKFKNQASVCKYLVPLGYPNQSVKNFEIDISQCPDNVELFLGAVDYKDGKLIGTGSRAIAVLGLGDT IAEAEQKAENAVKNIYGKLFHRPDIGTKELINKRIKHMNLLRGDKYQELK
Sequences:
>Translated_770_residues MLDKQIIANNIKNVLKSTNLDIKNKYIGKVRDMYFTDDKSILISTDRQSAFDRSLGFIPFKGQILAQSSVWWFKETAHIV KNHFIDSPDPNVVIARKAKVLPIEFVVRGYITGSTSTSLWTHYKNGSRDYCGNILPEGLKKNQKLPQNILTPTTKEQDHD RPISAEDIVKEGWLTQQQWDFASQKALELFEFGQKKALEHGLILADTKYEFGIDEQTGEIILIDEIHTPDSSRFWLKDSY ATRFENGEEPENIDKEFFRLWFAKNCDPYNDEVLPQAPQELVVELSQKYIALFEMITGQKFEVPRDLENINQRIVKNVTD YLNMEKPVNILLVGSGSREHAIAEAVKRSSIANKLFCISTAINPAIDKITQGYQIADICNCDEVLEYAKSQSIDIAIIGP EAPLEAGLADALKTAAIGVVGPTKKLAQLETSKGFTRDLIRDYDIGANPFFRKFNSMDGVEETLKKYQNQFVIKADGLCG GKGVLVWGDHLHSLDEAIRHCQSLVDAGKEFVIEEKLVGQEFSLISFTDGKNFIHMPAVQDHKRAHEGDKGPNTGGMGTY SDANHSLPFLSAADIERAKQINEKVVRALADKFGEPYQGILYGGFMATKDDTKVIEYNARFGDPEAMNLLTLLETDFVEI AQAITQGKLDTVKAKFKNQASVCKYLVPLGYPNQSVKNFEIDISQCPDNVELFLGAVDYKDGKLIGTGSRAIAVLGLGDT IAEAEQKAENAVKNIYGKLFHRPDIGTKELINKRIKHMNLLRGDKYQELK >Mature_770_residues MLDKQIIANNIKNVLKSTNLDIKNKYIGKVRDMYFTDDKSILISTDRQSAFDRSLGFIPFKGQILAQSSVWWFKETAHIV KNHFIDSPDPNVVIARKAKVLPIEFVVRGYITGSTSTSLWTHYKNGSRDYCGNILPEGLKKNQKLPQNILTPTTKEQDHD RPISAEDIVKEGWLTQQQWDFASQKALELFEFGQKKALEHGLILADTKYEFGIDEQTGEIILIDEIHTPDSSRFWLKDSY ATRFENGEEPENIDKEFFRLWFAKNCDPYNDEVLPQAPQELVVELSQKYIALFEMITGQKFEVPRDLENINQRIVKNVTD YLNMEKPVNILLVGSGSREHAIAEAVKRSSIANKLFCISTAINPAIDKITQGYQIADICNCDEVLEYAKSQSIDIAIIGP EAPLEAGLADALKTAAIGVVGPTKKLAQLETSKGFTRDLIRDYDIGANPFFRKFNSMDGVEETLKKYQNQFVIKADGLCG GKGVLVWGDHLHSLDEAIRHCQSLVDAGKEFVIEEKLVGQEFSLISFTDGKNFIHMPAVQDHKRAHEGDKGPNTGGMGTY SDANHSLPFLSAADIERAKQINEKVVRALADKFGEPYQGILYGGFMATKDDTKVIEYNARFGDPEAMNLLTLLETDFVEI AQAITQGKLDTVKAKFKNQASVCKYLVPLGYPNQSVKNFEIDISQCPDNVELFLGAVDYKDGKLIGTGSRAIAVLGLGDT IAEAEQKAENAVKNIYGKLFHRPDIGTKELINKRIKHMNLLRGDKYQELK
Specific function: De novo purine biosynthesis; second step. [C]
COG id: COG0151
COG function: function code F; Phosphoribosylamine-glycine ligase
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 1 ATP-grasp domain [H]
Homologues:
Organism=Homo sapiens, GI4503915, Length=436, Percent_Identity=32.7981651376147, Blast_Score=215, Evalue=1e-55, Organism=Homo sapiens, GI209869995, Length=436, Percent_Identity=32.7981651376147, Blast_Score=215, Evalue=1e-55, Organism=Homo sapiens, GI209869993, Length=436, Percent_Identity=32.7981651376147, Blast_Score=215, Evalue=1e-55, Organism=Homo sapiens, GI28416899, Length=438, Percent_Identity=32.8767123287671, Blast_Score=214, Evalue=2e-55, Organism=Escherichia coli, GI1790438, Length=438, Percent_Identity=33.1050228310502, Blast_Score=221, Evalue=1e-58, Organism=Caenorhabditis elegans, GI17567511, Length=432, Percent_Identity=35.1851851851852, Blast_Score=206, Evalue=4e-53, Organism=Saccharomyces cerevisiae, GI6321203, Length=467, Percent_Identity=28.9079229122056, Blast_Score=200, Evalue=6e-52, Organism=Saccharomyces cerevisiae, GI6319326, Length=304, Percent_Identity=37.828947368421, Blast_Score=168, Evalue=4e-42, Organism=Drosophila melanogaster, GI24582400, Length=427, Percent_Identity=31.8501170960187, Blast_Score=186, Evalue=4e-47, Organism=Drosophila melanogaster, GI62471619, Length=427, Percent_Identity=31.8501170960187, Blast_Score=185, Evalue=1e-46,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR011761 - InterPro: IPR013815 - InterPro: IPR013816 - InterPro: IPR013817 - InterPro: IPR016185 - InterPro: IPR020561 - InterPro: IPR000115 - InterPro: IPR020560 - InterPro: IPR020559 - InterPro: IPR020562 - InterPro: IPR011054 [H]
Pfam domain/function: PF01071 GARS_A; PF02843 GARS_C; PF02844 GARS_N [H]
EC number: =6.3.4.13 [H]
Molecular weight: Translated: 86383; Mature: 86383
Theoretical pI: Translated: 5.81; Mature: 5.81
Prosite motif: PS50975 ATP_GRASP ; PS01057 SAICAR_SYNTHETASE_1 ; PS01058 SAICAR_SYNTHETASE_2 ; PS00184 GARS
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.2 %Cys (Translated Protein) 1.3 %Met (Translated Protein) 2.5 %Cys+Met (Translated Protein) 1.2 %Cys (Mature Protein) 1.3 %Met (Mature Protein) 2.5 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MLDKQIIANNIKNVLKSTNLDIKNKYIGKVRDMYFTDDKSILISTDRQSAFDRSLGFIPF CCCHHHHHHHHHHHHHHCCCCHHHHHHHHHHHEEEECCCEEEEECCCHHHHHHCCCCCCC KGQILAQSSVWWFKETAHIVKNHFIDSPDPNVVIARKAKVLPIEFVVRGYITGSTSTSLW CCEEEECCCCHHHHHHHHHHHHHCCCCCCCCEEEECCCEECCHHHEEEEEEECCCCCCCE THYKNGSRDYCGNILPEGLKKNQKLPQNILTPTTKEQDHDRPISAEDIVKEGWLTQQQWD EECCCCCHHHHCCCCCHHHHHCCCCCHHHCCCCCCCCCCCCCCCHHHHHHHCCCCCHHHC FASQKALELFEFGQKKALEHGLILADTKYEFGIDEQTGEIILIDEIHTPDSSRFWLKDSY HHHHHHHHHHHHHHHHHHHCCEEEEECCEECCCCCCCCCEEEEEECCCCCCCCEEEECCH ATRFENGEEPENIDKEFFRLWFAKNCDPYNDEVLPQAPQELVVELSQKYIALFEMITGQK HHHCCCCCCCCHHHHHHHHHHHHCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHCCCC FEVPRDLENINQRIVKNVTDYLNMEKPVNILLVGSGSREHAIAEAVKRSSIANKLFCIST CCCCHHHHHHHHHHHHHHHHHHCCCCCCEEEEECCCCCHHHHHHHHHHHHHHHHEEEEEH AINPAIDKITQGYQIADICNCDEVLEYAKSQSIDIAIIGPEAPLEAGLADALKTAAIGVV HCCHHHHHHHCCCEEHHHCCHHHHHHHHHCCCCEEEEECCCCCHHHHHHHHHHHHHEECC GPTKKLAQLETSKGFTRDLIRDYDIGANPFFRKFNSMDGVEETLKKYQNQFVIKADGLCG CCHHHHHHHHHCCCHHHHHHHHCCCCCCHHHHHHCCCCCHHHHHHHHHCCEEEEECCCCC GKGVLVWGDHLHSLDEAIRHCQSLVDAGKEFVIEEKLVGQEFSLISFTDGKNFIHMPAVQ CCEEEEECHHHHHHHHHHHHHHHHHHCCHHHHHHHHHCCCCEEEEEEECCCCEEECCCCH DHKRAHEGDKGPNTGGMGTYSDANHSLPFLSAADIERAKQINEKVVRALADKFGEPYQGI HHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCE LYGGFMATKDDTKVIEYNARFGDPEAMNLLTLLETDFVEIAQAITQGKLDTVKAKFKNQA EEECEEECCCCCEEEEEECCCCCHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHCCHH SVCKYLVPLGYPNQSVKNFEIDISQCPDNVELFLGAVDYKDGKLIGTGSRAIAVLGLGDT HHHHHHHCCCCCCCCCCEEEEECCCCCCCEEEEEEEEECCCCEEEECCCCEEEEEECCHH IAEAEQKAENAVKNIYGKLFHRPDIGTKELINKRIKHMNLLRGDKYQELK HHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHCCCCCCCCC >Mature Secondary Structure MLDKQIIANNIKNVLKSTNLDIKNKYIGKVRDMYFTDDKSILISTDRQSAFDRSLGFIPF CCCHHHHHHHHHHHHHHCCCCHHHHHHHHHHHEEEECCCEEEEECCCHHHHHHCCCCCCC KGQILAQSSVWWFKETAHIVKNHFIDSPDPNVVIARKAKVLPIEFVVRGYITGSTSTSLW CCEEEECCCCHHHHHHHHHHHHHCCCCCCCCEEEECCCEECCHHHEEEEEEECCCCCCCE THYKNGSRDYCGNILPEGLKKNQKLPQNILTPTTKEQDHDRPISAEDIVKEGWLTQQQWD EECCCCCHHHHCCCCCHHHHHCCCCCHHHCCCCCCCCCCCCCCCHHHHHHHCCCCCHHHC FASQKALELFEFGQKKALEHGLILADTKYEFGIDEQTGEIILIDEIHTPDSSRFWLKDSY HHHHHHHHHHHHHHHHHHHCCEEEEECCEECCCCCCCCCEEEEEECCCCCCCCEEEECCH ATRFENGEEPENIDKEFFRLWFAKNCDPYNDEVLPQAPQELVVELSQKYIALFEMITGQK HHHCCCCCCCCHHHHHHHHHHHHCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHCCCC FEVPRDLENINQRIVKNVTDYLNMEKPVNILLVGSGSREHAIAEAVKRSSIANKLFCIST CCCCHHHHHHHHHHHHHHHHHHCCCCCCEEEEECCCCCHHHHHHHHHHHHHHHHEEEEEH AINPAIDKITQGYQIADICNCDEVLEYAKSQSIDIAIIGPEAPLEAGLADALKTAAIGVV HCCHHHHHHHCCCEEHHHCCHHHHHHHHHCCCCEEEEECCCCCHHHHHHHHHHHHHEECC GPTKKLAQLETSKGFTRDLIRDYDIGANPFFRKFNSMDGVEETLKKYQNQFVIKADGLCG CCHHHHHHHHHCCCHHHHHHHHCCCCCCHHHHHHCCCCCHHHHHHHHHCCEEEEECCCCC GKGVLVWGDHLHSLDEAIRHCQSLVDAGKEFVIEEKLVGQEFSLISFTDGKNFIHMPAVQ CCEEEEECHHHHHHHHHHHHHHHHHHCCHHHHHHHHHCCCCEEEEEEECCCCEEECCCCH DHKRAHEGDKGPNTGGMGTYSDANHSLPFLSAADIERAKQINEKVVRALADKFGEPYQGI HHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCE LYGGFMATKDDTKVIEYNARFGDPEAMNLLTLLETDFVEIAQAITQGKLDTVKAKFKNQA EEECEEECCCCCEEEEEECCCCCHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHCCHH SVCKYLVPLGYPNQSVKNFEIDISQCPDNVELFLGAVDYKDGKLIGTGSRAIAVLGLGDT HHHHHHHCCCCCCCCCCEEEEECCCCCCCEEEEEEEEECCCCEEEECCCCEEEEEECCHH IAEAEQKAENAVKNIYGKLFHRPDIGTKELINKRIKHMNLLRGDKYQELK HHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHCCCCCCCCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: NA