| Definition | Nitrosospira multiformis ATCC 25196 chromosome, complete genome. |
|---|---|
| Accession | NC_007614 |
| Length | 3,184,243 |
Click here to switch to the map view.
The map label for this gene is purF [H]
Identifier: 82703027
GI number: 82703027
Start: 2196291
End: 2197811
Strand: Reverse
Name: purF [H]
Synonym: Nmul_A1906
Alternate gene names: 82703027
Gene position: 2197811-2196291 (Counterclockwise)
Preceding gene: 82703028
Following gene: 82703026
Centisome position: 69.02
GC content: 55.62
Gene sequence:
>1521_bases ATGTGTGGAATTCTGGGTTTAGTTTCGCATGCTCCCGTCAACCAGTTACTCTACGATGGGTTGCTGGTGCTGCAGCATCG TGGTCAGGATGCGGCCGGGATTGTTACCGCCCAGGGGAATACTTTCCACATGCACAAGAACAGCGGCCTCGTGCGCGACG TGTTCCGCACGCGGAATATGCGCGCCTTGCTGGGGAATATGGGGATCGGCCAAGTGCGCTATCCTACCGCAGGTTCCGCC GAGTCCCCTGCAGAAGCGCAGCCGTTTTATGTCAACTCACCCTTCGGAATCGTACTCGGGCATAACGGCAATCTGACCAA TTCCGCACAGCTCAACGACGAGTTGTTCCGCGAGGATTTACGGCACGTCAACACCAATTCGGATTCGGAAGTGCTCCTTA ATGTGCTGGCCCACGAGTTGCAGAGGAGCACGAAAAACCACCAGCTTGATCCCGCCGCTATTTTTGCCGCCGTATCCGGC GTGCACGAGCGTTGCAAAGGCGCCTACGCCGTCATAGCAATGATTGCGGGTTACGGATTGCTCGCGTTCCGCGACCCTTA TGGTATTCGCCCCCTTGTGTTCGGGTGCGCGGAAACGGAGCATGGGACGGAATATCTGGTAGCGTCCGAGAGTGTGGCGC TCGATACTCTGGGATTCAAGCTGGTGAGGGATGTTGCGCCGGGCGAGGCAATTTTTATTGATGACACCGGCAATTTTTAC AGTAAGCAGTGCGCGTCCAACCCCTCGCACAATCCCTGCATCTTCGAGTATGTCTATCTCGCACGCCCGGATTCAGTCAT AGACGGAATTTCAGTCTATGAAACGCGGCTCAACATGGGAGAGAGTCTGGCCGATAAAGTCAAAGCCACGATGGGTCATC TCGATATCGATGTAGTCATTCCGATTCCCGATTCCAGCCGTCCCAGCGCCTTGCAGCTTGCCAACCGCCTGGGCATAAGT TTTCGTGAAGGTTTCGTAAAAAACCGCTACATCGGGCGAACCTTTATCATGCCGGGCCAGCAGTTGCGCCGTAAATCGGT CCGCCAGAAGCTCAATGCCATGGGGGTGGAGTTTCGCGGAAAAAATGTGTTGCTGGTGGATGATTCGATCGTACGCGGCA CTACCAGCCGCGAAATCGTCCAGATGGCGAAGGAAGCCGGTGCGAACAAGGTATTCTTTGCTTCTGCTGCCCCCCCCGTG CGGTTTCCCAACGTTTATGGCATCGATATGCCTACGCGCCACGAACTCATTGCCACGGGGCGGGACGACGAGGAAATATG CCGGGAAATTGGCGCCGATTATCTGGTGTATCAGGAACTCGATTCTCTCATTAAAGATGTGGGCCGTGTCAATCCGTCGA TCTCGCAGTATGAGACCTCATGTTTCGACGGACGCTACATTACCGGGGATGTAACGCCGGAATACCTGGCCGTCCTGGAG GCGCAACGCAGTGGCGGCGCTCCTCTTACCGAGAGACGTTCCAGCACGCAACTCGACCTGAATCTCGTGACAGCGAATTA A
Upstream 100 bases:
>100_bases AAGCAATAGGGCAGTAAACCGAATGCGCAGGATTCCACTCACTGAACTCGTGCAACTTTTCGTATAGCGTCGATCTAAGT CATTTTTGCGGAGTGCATTC
Downstream 100 bases:
>100_bases TGAAGATTTGACAAAAGCAGGTACCGAGCGTACCTTCAGGGCAGGCGCCGATTTGATCTTCAGCTTGCGGGCGCAGTATA AATTCAGCTAAAGCGGGAAA
Product: amidophosphoribosyltransferase
Products: NA
Alternate protein names: ATase; Glutamine phosphoribosylpyrophosphate amidotransferase; GPATase [H]
Number of amino acids: Translated: 506; Mature: 506
Protein sequence:
>506_residues MCGILGLVSHAPVNQLLYDGLLVLQHRGQDAAGIVTAQGNTFHMHKNSGLVRDVFRTRNMRALLGNMGIGQVRYPTAGSA ESPAEAQPFYVNSPFGIVLGHNGNLTNSAQLNDELFREDLRHVNTNSDSEVLLNVLAHELQRSTKNHQLDPAAIFAAVSG VHERCKGAYAVIAMIAGYGLLAFRDPYGIRPLVFGCAETEHGTEYLVASESVALDTLGFKLVRDVAPGEAIFIDDTGNFY SKQCASNPSHNPCIFEYVYLARPDSVIDGISVYETRLNMGESLADKVKATMGHLDIDVVIPIPDSSRPSALQLANRLGIS FREGFVKNRYIGRTFIMPGQQLRRKSVRQKLNAMGVEFRGKNVLLVDDSIVRGTTSREIVQMAKEAGANKVFFASAAPPV RFPNVYGIDMPTRHELIATGRDDEEICREIGADYLVYQELDSLIKDVGRVNPSISQYETSCFDGRYITGDVTPEYLAVLE AQRSGGAPLTERRSSTQLDLNLVTAN
Sequences:
>Translated_506_residues MCGILGLVSHAPVNQLLYDGLLVLQHRGQDAAGIVTAQGNTFHMHKNSGLVRDVFRTRNMRALLGNMGIGQVRYPTAGSA ESPAEAQPFYVNSPFGIVLGHNGNLTNSAQLNDELFREDLRHVNTNSDSEVLLNVLAHELQRSTKNHQLDPAAIFAAVSG VHERCKGAYAVIAMIAGYGLLAFRDPYGIRPLVFGCAETEHGTEYLVASESVALDTLGFKLVRDVAPGEAIFIDDTGNFY SKQCASNPSHNPCIFEYVYLARPDSVIDGISVYETRLNMGESLADKVKATMGHLDIDVVIPIPDSSRPSALQLANRLGIS FREGFVKNRYIGRTFIMPGQQLRRKSVRQKLNAMGVEFRGKNVLLVDDSIVRGTTSREIVQMAKEAGANKVFFASAAPPV RFPNVYGIDMPTRHELIATGRDDEEICREIGADYLVYQELDSLIKDVGRVNPSISQYETSCFDGRYITGDVTPEYLAVLE AQRSGGAPLTERRSSTQLDLNLVTAN >Mature_506_residues MCGILGLVSHAPVNQLLYDGLLVLQHRGQDAAGIVTAQGNTFHMHKNSGLVRDVFRTRNMRALLGNMGIGQVRYPTAGSA ESPAEAQPFYVNSPFGIVLGHNGNLTNSAQLNDELFREDLRHVNTNSDSEVLLNVLAHELQRSTKNHQLDPAAIFAAVSG VHERCKGAYAVIAMIAGYGLLAFRDPYGIRPLVFGCAETEHGTEYLVASESVALDTLGFKLVRDVAPGEAIFIDDTGNFY SKQCASNPSHNPCIFEYVYLARPDSVIDGISVYETRLNMGESLADKVKATMGHLDIDVVIPIPDSSRPSALQLANRLGIS FREGFVKNRYIGRTFIMPGQQLRRKSVRQKLNAMGVEFRGKNVLLVDDSIVRGTTSREIVQMAKEAGANKVFFASAAPPV RFPNVYGIDMPTRHELIATGRDDEEICREIGADYLVYQELDSLIKDVGRVNPSISQYETSCFDGRYITGDVTPEYLAVLE AQRSGGAPLTERRSSTQLDLNLVTAN
Specific function: De novo purine biosynthesis; first step. [C]
COG id: COG0034
COG function: function code F; Glutamine phosphoribosylpyrophosphate amidotransferase
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 1 glutamine amidotransferase type-2 domain [H]
Homologues:
Organism=Homo sapiens, GI29570798, Length=474, Percent_Identity=36.7088607594937, Blast_Score=281, Evalue=8e-76, Organism=Escherichia coli, GI1788651, Length=499, Percent_Identity=59.9198396793587, Blast_Score=601, Evalue=1e-173, Organism=Escherichia coli, GI1790167, Length=218, Percent_Identity=29.3577981651376, Blast_Score=65, Evalue=2e-11, Organism=Caenorhabditis elegans, GI17554892, Length=482, Percent_Identity=34.2323651452282, Blast_Score=254, Evalue=1e-67, Organism=Saccharomyces cerevisiae, GI6323958, Length=492, Percent_Identity=51.6260162601626, Blast_Score=477, Evalue=1e-135, Organism=Drosophila melanogaster, GI24659598, Length=506, Percent_Identity=34.9802371541502, Blast_Score=272, Evalue=5e-73, Organism=Drosophila melanogaster, GI24659604, Length=482, Percent_Identity=36.0995850622407, Blast_Score=269, Evalue=3e-72, Organism=Drosophila melanogaster, GI28573187, Length=498, Percent_Identity=33.3333333333333, Blast_Score=262, Evalue=3e-70,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR005854 - InterPro: IPR000583 - InterPro: IPR017932 - InterPro: IPR000836 [H]
Pfam domain/function: PF00310 GATase_2; PF00156 Pribosyltran [H]
EC number: =2.4.2.14 [H]
Molecular weight: Translated: 55455; Mature: 55455
Theoretical pI: Translated: 6.33; Mature: 6.33
Prosite motif: PS00103 PUR_PYR_PR_TRANSFER ; PS00443 GATASE_TYPE_II ; PS00639 THIOL_PROTEASE_HIS
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.4 %Cys (Translated Protein) 2.2 %Met (Translated Protein) 3.6 %Cys+Met (Translated Protein) 1.4 %Cys (Mature Protein) 2.2 %Met (Mature Protein) 3.6 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MCGILGLVSHAPVNQLLYDGLLVLQHRGQDAAGIVTAQGNTFHMHKNSGLVRDVFRTRNM CCCHHHHHCCCCHHHHHHHCCCEEEECCCCCCEEEEECCCEEEEECCCCHHHHHHHHCCH RALLGNMGIGQVRYPTAGSAESPAEAQPFYVNSPFGIVLGHNGNLTNSAQLNDELFREDL HHHHHCCCCCEEECCCCCCCCCCCCCCCEEECCCEEEEEECCCCCCCCCCCCHHHHHHHH RHVNTNSDSEVLLNVLAHELQRSTKNHQLDPAAIFAAVSGVHERCKGAYAVIAMIAGYGL HHCCCCCHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCCE LAFRDPYGIRPLVFGCAETEHGTEYLVASESVALDTLGFKLVRDVAPGEAIFIDDTGNFY EEECCCCCCCCEEEECCCCCCCCEEEEECCCHHHHHHHHHHHHHCCCCCEEEEECCCCHH SKQCASNPSHNPCIFEYVYLARPDSVIDGISVYETRLNMGESLADKVKATMGHLDIDVVI HHHHCCCCCCCCEEEEEEEEECCCHHHCCHHHHHHHHHCCHHHHHHHHHHHCCCEEEEEE PIPDSSRPSALQLANRLGISFREGFVKNRYIGRTFIMPGQQLRRKSVRQKLNAMGVEFRG ECCCCCCCHHHHHHHHHCCHHHHHHHHCCCCCEEEECCCHHHHHHHHHHHHHHCCEEECC KNVLLVDDSIVRGTTSREIVQMAKEAGANKVFFASAAPPVRFPNVYGIDMPTRHELIATG CEEEEECCHHHCCCCHHHHHHHHHHCCCCEEEEECCCCCCCCCCEEECCCCCCCCEEECC RDDEEICREIGADYLVYQELDSLIKDVGRVNPSISQYETSCFDGRYITGDVTPEYLAVLE CCHHHHHHHHCCCHHHHHHHHHHHHHHHHCCCCHHHHHHHHCCCEEEECCCCHHHHHHHH AQRSGGAPLTERRSSTQLDLNLVTAN HHCCCCCCCHHCCCCCEEEEEEEECC >Mature Secondary Structure MCGILGLVSHAPVNQLLYDGLLVLQHRGQDAAGIVTAQGNTFHMHKNSGLVRDVFRTRNM CCCHHHHHCCCCHHHHHHHCCCEEEECCCCCCEEEEECCCEEEEECCCCHHHHHHHHCCH RALLGNMGIGQVRYPTAGSAESPAEAQPFYVNSPFGIVLGHNGNLTNSAQLNDELFREDL HHHHHCCCCCEEECCCCCCCCCCCCCCCEEECCCEEEEEECCCCCCCCCCCCHHHHHHHH RHVNTNSDSEVLLNVLAHELQRSTKNHQLDPAAIFAAVSGVHERCKGAYAVIAMIAGYGL HHCCCCCHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCCE LAFRDPYGIRPLVFGCAETEHGTEYLVASESVALDTLGFKLVRDVAPGEAIFIDDTGNFY EEECCCCCCCCEEEECCCCCCCCEEEEECCCHHHHHHHHHHHHHCCCCCEEEEECCCCHH SKQCASNPSHNPCIFEYVYLARPDSVIDGISVYETRLNMGESLADKVKATMGHLDIDVVI HHHHCCCCCCCCEEEEEEEEECCCHHHCCHHHHHHHHHCCHHHHHHHHHHHCCCEEEEEE PIPDSSRPSALQLANRLGISFREGFVKNRYIGRTFIMPGQQLRRKSVRQKLNAMGVEFRG ECCCCCCCHHHHHHHHHCCHHHHHHHHCCCCCEEEECCCHHHHHHHHHHHHHHCCEEECC KNVLLVDDSIVRGTTSREIVQMAKEAGANKVFFASAAPPVRFPNVYGIDMPTRHELIATG CEEEEECCHHHCCCCHHHHHHHHHHCCCCEEEEECCCCCCCCCCEEECCCCCCCCEEECC RDDEEICREIGADYLVYQELDSLIKDVGRVNPSISQYETSCFDGRYITGDVTPEYLAVLE CCHHHHHHHHCCCHHHHHHHHHHHHHHHHCCCCHHHHHHHHCCCEEEECCCCHHHHHHHH AQRSGGAPLTERRSSTQLDLNLVTAN HHCCCCCCCHHCCCCCEEEEEEEECC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 10984043; 7704274 [H]