| Definition | Novosphingobium aromaticivorans DSM 12444 chromosome, complete genome. |
|---|---|
| Accession | NC_007794 |
| Length | 3,561,584 |
Click here to switch to the map view.
The map label for this gene is purD [H]
Identifier: 87198198
GI number: 87198198
Start: 172861
End: 174150
Strand: Direct
Name: purD [H]
Synonym: Saro_0172
Alternate gene names: 87198198
Gene position: 172861-174150 (Clockwise)
Preceding gene: 87198192
Following gene: 87198204
Centisome position: 4.85
GC content: 65.5
Gene sequence:
>1290_bases ATGAATATCCTGCTGCTGGGATCGGGTGGGCGTGAACATGCCCTGGCATGGAAATTGGCCCAATCGCCCCTCACGGGCAA GCTCTATGCCGCCCCGGGCAACCCGGGCATCGCCCAGCACGCCGATCTGGTCGCGCTTGACCTGACCGATCATGCGAGCG TCGTCACCTTCTGCGAGACCAACCGCATCGGGCTGGTCGTCGTCGGCCCGGAAGCGCCGCTGGTCGATGGCCTGACGGAT TCGCTGCGCGCGGCGGGTTTTTCGGTGTTCGGGCCAAGCCGTGCGGCCGCGCAGCTCGAAGGATCGAAGGGCTTTACCAA GGACCTGTGCGCGCGGGCGGATATCCCGACGGCAGGATATGTCCGCGCGAAGTCGCTTGAAGAAGCGCGGGCCGCGCTGG CCGAGTTCGGCGCTCCGGTCGTGATCAAGGCCGACGGGCTGGCCGCGGGCAAGGGCGTTGTCGTGGCAATGACCATGGAA GAAGCCGAGGCAGCGGTCGACGACATGTTCGATGGCGCATTCGGTTCGGCCGGCGCGGAAGTGGTGGTCGAGGAGTTCCT TACCGGTGAGGAGGCTAGCTTCTTCGCCCTGACCGACGGCGCCACGATCGTGCCTTTTGCTTCCGCTCAGGATCACAAGC GCGTGGGCGATGGCGATACCGGACCCAACACCGGCGGCATGGGCGCCTACAGCCCGGCGCGCGTGCTGACCCCGGAACTC GAGGCGCAGGCGCTTTCGCAGATCATTGCTCCGACCGTAAAGGCCATGGCGGACGAGGGCATGCCTTATTCAGGCGTGCT CTATGCTGGCCTCATGCTCACGGAACAGGGCCCCAAGCTGATCGAATACAACGCGCGCTTCGGCGATCCCGAATGCCAGG TGCTGATGATGCGCCTCGAGAGCGATCTGGTCGAACTGCTGCTGGCCTGCGCCGACAACAAGCTGTCGAGCATACAGCCG CCGCGCTTCTCCAACGAAGTGGCGATGACCGTGGTCATGGCCGCGCAGGGCTATCCCGGCACGCCGAAGAAGGGCGGCCG GATCGATCATATCCCGGCAGCAGAGGCCGGCGGCGCGAAAGTCTTCCATGCTGGCACCGTTCTTTCGGGCGATGGCGTCC TTTCGGCCAATGGCGGGCGCGTCCTGAATGTCACGGCCAAGGGACCGACTGTAAAGTCCGCGCGCGATGCCGCCTATGCG GCGGTCGATGCGATCAGCTTTCCGGAAGGCTTCTGCCGCCGAGACATCGGCTGGCGCGAGATCGAGCGCGAGGAAGCCGC TAGCGTCTGA
Upstream 100 bases:
>100_bases GATCGAGAGGGCGGGAGCGTTGTCGCCAGCCGATTCCCTCGCTAGGAGCCCGCCCGAGCCGTTGTTATCGTCGTCGTCAT AGGGCGCGGAAGGGAAAGCC
Downstream 100 bases:
>100_bases GGAAGGCCAGGGCCTCCGCCTCGCCGATCACTTCGGCGTACTTGGCCTGGAGATCGAACAGGTTGGCCTCGTGCGGGGCC TGGTGGCGGTCACCGCAGGC
Product: phosphoribosylamine--glycine ligase
Products: NA
Alternate protein names: GARS; Glycinamide ribonucleotide synthetase; Phosphoribosylglycinamide synthetase [H]
Number of amino acids: Translated: 429; Mature: 429
Protein sequence:
>429_residues MNILLLGSGGREHALAWKLAQSPLTGKLYAAPGNPGIAQHADLVALDLTDHASVVTFCETNRIGLVVVGPEAPLVDGLTD SLRAAGFSVFGPSRAAAQLEGSKGFTKDLCARADIPTAGYVRAKSLEEARAALAEFGAPVVIKADGLAAGKGVVVAMTME EAEAAVDDMFDGAFGSAGAEVVVEEFLTGEEASFFALTDGATIVPFASAQDHKRVGDGDTGPNTGGMGAYSPARVLTPEL EAQALSQIIAPTVKAMADEGMPYSGVLYAGLMLTEQGPKLIEYNARFGDPECQVLMMRLESDLVELLLACADNKLSSIQP PRFSNEVAMTVVMAAQGYPGTPKKGGRIDHIPAAEAGGAKVFHAGTVLSGDGVLSANGGRVLNVTAKGPTVKSARDAAYA AVDAISFPEGFCRRDIGWREIEREEAASV
Sequences:
>Translated_429_residues MNILLLGSGGREHALAWKLAQSPLTGKLYAAPGNPGIAQHADLVALDLTDHASVVTFCETNRIGLVVVGPEAPLVDGLTD SLRAAGFSVFGPSRAAAQLEGSKGFTKDLCARADIPTAGYVRAKSLEEARAALAEFGAPVVIKADGLAAGKGVVVAMTME EAEAAVDDMFDGAFGSAGAEVVVEEFLTGEEASFFALTDGATIVPFASAQDHKRVGDGDTGPNTGGMGAYSPARVLTPEL EAQALSQIIAPTVKAMADEGMPYSGVLYAGLMLTEQGPKLIEYNARFGDPECQVLMMRLESDLVELLLACADNKLSSIQP PRFSNEVAMTVVMAAQGYPGTPKKGGRIDHIPAAEAGGAKVFHAGTVLSGDGVLSANGGRVLNVTAKGPTVKSARDAAYA AVDAISFPEGFCRRDIGWREIEREEAASV >Mature_429_residues MNILLLGSGGREHALAWKLAQSPLTGKLYAAPGNPGIAQHADLVALDLTDHASVVTFCETNRIGLVVVGPEAPLVDGLTD SLRAAGFSVFGPSRAAAQLEGSKGFTKDLCARADIPTAGYVRAKSLEEARAALAEFGAPVVIKADGLAAGKGVVVAMTME EAEAAVDDMFDGAFGSAGAEVVVEEFLTGEEASFFALTDGATIVPFASAQDHKRVGDGDTGPNTGGMGAYSPARVLTPEL EAQALSQIIAPTVKAMADEGMPYSGVLYAGLMLTEQGPKLIEYNARFGDPECQVLMMRLESDLVELLLACADNKLSSIQP PRFSNEVAMTVVMAAQGYPGTPKKGGRIDHIPAAEAGGAKVFHAGTVLSGDGVLSANGGRVLNVTAKGPTVKSARDAAYA AVDAISFPEGFCRRDIGWREIEREEAASV
Specific function: De novo purine biosynthesis; second step. [C]
COG id: COG0151
COG function: function code F; Phosphoribosylamine-glycine ligase
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 1 ATP-grasp domain [H]
Homologues:
Organism=Homo sapiens, GI4503915, Length=424, Percent_Identity=48.3490566037736, Blast_Score=376, Evalue=1e-104, Organism=Homo sapiens, GI209869995, Length=424, Percent_Identity=48.3490566037736, Blast_Score=376, Evalue=1e-104, Organism=Homo sapiens, GI209869993, Length=424, Percent_Identity=48.3490566037736, Blast_Score=376, Evalue=1e-104, Organism=Homo sapiens, GI28416899, Length=425, Percent_Identity=48.2352941176471, Blast_Score=375, Evalue=1e-104, Organism=Escherichia coli, GI1790438, Length=429, Percent_Identity=56.8764568764569, Blast_Score=470, Evalue=1e-134, Organism=Caenorhabditis elegans, GI17567511, Length=423, Percent_Identity=41.371158392435, Blast_Score=303, Evalue=8e-83, Organism=Saccharomyces cerevisiae, GI6321203, Length=451, Percent_Identity=42.5720620842572, Blast_Score=332, Evalue=9e-92, Organism=Drosophila melanogaster, GI62471619, Length=415, Percent_Identity=45.7831325301205, Blast_Score=310, Evalue=2e-84, Organism=Drosophila melanogaster, GI24582400, Length=415, Percent_Identity=45.7831325301205, Blast_Score=309, Evalue=2e-84,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR011761 - InterPro: IPR013815 - InterPro: IPR013816 - InterPro: IPR013817 - InterPro: IPR016185 - InterPro: IPR020561 - InterPro: IPR000115 - InterPro: IPR020560 - InterPro: IPR020559 - InterPro: IPR020562 - InterPro: IPR011054 [H]
Pfam domain/function: PF01071 GARS_A; PF02843 GARS_C; PF02844 GARS_N [H]
EC number: =6.3.4.13 [H]
Molecular weight: Translated: 44424; Mature: 44424
Theoretical pI: Translated: 4.52; Mature: 4.52
Prosite motif: PS50975 ATP_GRASP ; PS00184 GARS
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.2 %Cys (Translated Protein) 2.8 %Met (Translated Protein) 4.0 %Cys+Met (Translated Protein) 1.2 %Cys (Mature Protein) 2.8 %Met (Mature Protein) 4.0 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MNILLLGSGGREHALAWKLAQSPLTGKLYAAPGNPGIAQHADLVALDLTDHASVVTFCET CEEEEECCCCCCCCEEEEECCCCCCCEEEECCCCCCCCCCCCEEEEEECCCCEEEEEEEC NRIGLVVVGPEAPLVDGLTDSLRAAGFSVFGPSRAAAQLEGSKGFTKDLCARADIPTAGY CCEEEEEECCCCCCCCCHHHHHHHCCEEEECCCCHHHEECCCCCCHHHHHHHCCCCCCCC VRAKSLEEARAALAEFGAPVVIKADGLAAGKGVVVAMTMEEAEAAVDDMFDGAFGSAGAE EEHHHHHHHHHHHHHCCCCEEEEECCCCCCCCEEEEEEHHHHHHHHHHHHCCCCCCCCHH VVVEEFLTGEEASFFALTDGATIVPFASAQDHKRVGDGDTGPNTGGMGAYSPARVLTPEL HHHHHHHCCCCCEEEEEECCCEEEEECCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCHH EAQALSQIIAPTVKAMADEGMPYSGVLYAGLMLTEQGPKLIEYNARFGDPECQVLMMRLE HHHHHHHHHHHHHHHHHHCCCCCCCHHEEEEEEECCCCCEEEECCCCCCCHHHHHHHHHH SDLVELLLACADNKLSSIQPPRFSNEVAMTVVMAAQGYPGTPKKGGRIDHIPAAEAGGAK HHHHHHHHHHCCCCHHCCCCCCCCCCEEEEEEEEECCCCCCCCCCCEECCCCCCCCCCCE VFHAGTVLSGDGVLSANGGRVLNVTAKGPTVKSARDAAYAAVDAISFPEGFCRRDIGWRE EEEECEEEECCCEEECCCCEEEEEEECCCCCCCHHHHHHHHHHHCCCCHHHHHCCCCHHH IEREEAASV HHHHHHCCC >Mature Secondary Structure MNILLLGSGGREHALAWKLAQSPLTGKLYAAPGNPGIAQHADLVALDLTDHASVVTFCET CEEEEECCCCCCCCEEEEECCCCCCCEEEECCCCCCCCCCCCEEEEEECCCCEEEEEEEC NRIGLVVVGPEAPLVDGLTDSLRAAGFSVFGPSRAAAQLEGSKGFTKDLCARADIPTAGY CCEEEEEECCCCCCCCCHHHHHHHCCEEEECCCCHHHEECCCCCCHHHHHHHCCCCCCCC VRAKSLEEARAALAEFGAPVVIKADGLAAGKGVVVAMTMEEAEAAVDDMFDGAFGSAGAE EEHHHHHHHHHHHHHCCCCEEEEECCCCCCCCEEEEEEHHHHHHHHHHHHCCCCCCCCHH VVVEEFLTGEEASFFALTDGATIVPFASAQDHKRVGDGDTGPNTGGMGAYSPARVLTPEL HHHHHHHCCCCCEEEEEECCCEEEEECCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCHH EAQALSQIIAPTVKAMADEGMPYSGVLYAGLMLTEQGPKLIEYNARFGDPECQVLMMRLE HHHHHHHHHHHHHHHHHHCCCCCCCHHEEEEEEECCCCCEEEECCCCCCCHHHHHHHHHH SDLVELLLACADNKLSSIQPPRFSNEVAMTVVMAAQGYPGTPKKGGRIDHIPAAEAGGAK HHHHHHHHHHCCCCHHCCCCCCCCCCEEEEEEEEECCCCCCCCCCCEECCCCCCCCCCCE VFHAGTVLSGDGVLSANGGRVLNVTAKGPTVKSARDAAYAAVDAISFPEGFCRRDIGWRE EEEECEEEECCCEEECCCCEEEEEEECCCCCCCHHHHHHHHHHHCCCCHHHHHCCCCHHH IEREEAASV HHHHHHCCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 11214968 [H]