| Definition | Ruegeria sp. TM1040, complete genome. |
|---|---|
| Accession | NC_008044 |
| Length | 3,200,938 |
Click here to switch to the map view.
The map label for this gene is purL
Identifier: 99080959
GI number: 99080959
Start: 1199601
End: 1201766
Strand: Reverse
Name: purL
Synonym: TM1040_1118
Alternate gene names: 99080959
Gene position: 1201766-1199601 (Counterclockwise)
Preceding gene: 99080960
Following gene: 99080958
Centisome position: 37.54
GC content: 61.31
Gene sequence:
>2166_bases ATGCAGGAACCAGCCATTACGCCTGAAGTGATCGAAAACCACGGACTGAAGCCCGATGAATACGATCTGATCCTCGAGAT CATCGGCCGCGAGCCGACCTTCACCGAGCTCGGCATTTTCTCCGCCATGTGGAACGAGCACTGTTCCTATAAATCATCGA AAAAATGGCTGCGCACCCTGCCGACCTCCGGCCCGCAGGTGATCTGCGGCCCCGGCGAGAACGCCGGCATCGTGGACATC GGCGATGGCGATGCGGTCGTCTTCAAGATGGAAAGCCACAACCACCCCTCCTACATCGAGCCCTATCAAGGTGCCGCCAC TGGTGTTGGCGGCATTTTGCGTGATGTCTTCACCATGGGCGCGCGGCCTATCGCGTCGATGAATTCGCTGTCCTTTGGTG AGCCTGCGCATCACAAGACCCGCCAATTGGTAAACGGCGTGGTTGAGGGCGTCGGCGGCTACGGCAACTGTTTTGGTGTG CCTTGTGTCGGCGGCGAAGTGCGCTTTCACCCCGCCTACAATGGCAACTGCCTGGTGAACGCCTTTGCGGCAGGCCTCGT AAAAACCGACATGATCTTCTACTCCGCCGCCTCCGGTGTGGGCATGCCCGTTGTGTACCTCGGCGCCAAGACCGGCCGCG ACGGGGTTGGTGGTGCAACCATGGCGTCGGCAGAATTCGACGACACCATCGAAGAAAAGCGCCCCACCGTGCAGGTTGGT GACCCGTTCACCGAAAAACGCCTGATGGAAGCCACGCTGGAGCTGATGCAGACCGGTGCCGTGATCTCCATTCAGGACAT GGGCGCGGCAGGCCTCACCTGCTCCGCTGTGGAAATGGGTGACAAGGGCGGCCTTGGCGTGCGTCTGGATCTGGAAAAGG TTCCGCAGCGCGAAGAAAACATGACCGCTTACGAGATGATGCTCTCGGAATCGCAAGAGCGCATGCTGATGGTGCTGAAG CCCGAGCTGGAGGCCGAGGCCAAAGCCGTCTTTGAGAAATGGGACCTCGATTTTGCCATAGTGGGTGAGACCATTGCCGA AGATCGCTTCCTCATCATGCACAACGGCGAGGTCAAAGCGGATCTGCCGCTGTCAAAGCTTTCGTCCTCGGCGCCGGAAT ACGACCGCCCGTGGATCGAGGTCGAGGCCCCCGCGGCGCTTACGGATGCGGATGTGCCGACCATTGACCCGATCGACGGC CTGAAGGCGCTGATCTCCAGCCCCAACTATGCCGGCAAACAGTGGGTCTATGAGCAATATGACACCACCGTGATGGGCGA CACCGCGCGTCGTCCGGGTCTGGGTGGCGGCATGGTCCGCGTGCATGGCACCGACAAGAAACTGGCCTTTACCTCTGACG TGACCCCGCGTTACGTCAAGGCGAACCCGGTTGAGGGCGGCAAACAGGCCGTGGCCGAAGCCTATCGCAACCTCTGCGCT GTCGGGGCCAAGCCATTGGCGACCACCGACAACCTCAATTTCGGCAACCCCGAAAAGCCCGAGATCATGGGCCAATTTGT CGGCGCACTCAAAGGCATCGGCGAGGCGGTCTCGGCGCTTGATATGCCAATCGTCTCGGGCAACGTCTCGCTTTACAACG AAACAGACGGCCAGGCGATCCTGCCGACACCGACCATTGGCGCGGTAGGTCTGGTTGCGGCGGGCGAAGAGCCGATCCTG GGCGAGGCCCGCGACGGTCATGTGCTGCTGCTGGTGGGCGAAACCATTGGTCATCTTGGCCAGTCGGCGCTTCTGCACGA GGTCTTCAACCGCGAGGACGGCGACGCCCCCGCAGTGGATCTTGAGATCGAAAAGCGCAACGGCGAGTTCATCCGCAACA ACCGCGATTTCATCAAGGCCTGCACCGACATCAGCGACGGTGGGCTTGCGCTCGCGGCGTTTGAGCTTGCAGAGGCCGCA GGCGTAGGGGTGCAGATCGACGCCAGCGACACCCCGACGCTCTTTGGTGAGGATCAGGCACGCTATCTGGTGGCCTGCAA CTTCGACCAGGCCGAGGCGCTGATGATCGCTGCCGGTCAGGCCGGGGTGCCGCTTGAGACCGTTGGCAAGTTTACCGGCG ACACGGTGAAGATGGGCGGATCGGAGGCAACGCTCGAAGAGCTGAGCCAGATCTTCCGCACGAGCTTTGCCGAAGCAGTC GCCTAA
Upstream 100 bases:
>100_bases TGAGGCAATCTCTGCACGCCTCTCATGCCCCCTTTCCCCGCAGCGGGGCTTGCTCTAAAAGGCCGACAACATGAAGCGAC CCGGGGGGCCATCTAGCGCC
Downstream 100 bases:
>100_bases TCACAAAAGGCGGGGACACTCCCGCGCCCGGAGGGGCCTTAGCTGTTGCTAAGCCCCCTTGGCGGCCTTGGGCCCGGCAC CGCGCCTGCGCGGTGCCGGG
Product: phosphoribosylformylglycinamidine synthase II
Products: NA
Alternate protein names: Phosphoribosylformylglycinamidine synthase II; FGAM synthase II
Number of amino acids: Translated: 721; Mature: 721
Protein sequence:
>721_residues MQEPAITPEVIENHGLKPDEYDLILEIIGREPTFTELGIFSAMWNEHCSYKSSKKWLRTLPTSGPQVICGPGENAGIVDI GDGDAVVFKMESHNHPSYIEPYQGAATGVGGILRDVFTMGARPIASMNSLSFGEPAHHKTRQLVNGVVEGVGGYGNCFGV PCVGGEVRFHPAYNGNCLVNAFAAGLVKTDMIFYSAASGVGMPVVYLGAKTGRDGVGGATMASAEFDDTIEEKRPTVQVG DPFTEKRLMEATLELMQTGAVISIQDMGAAGLTCSAVEMGDKGGLGVRLDLEKVPQREENMTAYEMMLSESQERMLMVLK PELEAEAKAVFEKWDLDFAIVGETIAEDRFLIMHNGEVKADLPLSKLSSSAPEYDRPWIEVEAPAALTDADVPTIDPIDG LKALISSPNYAGKQWVYEQYDTTVMGDTARRPGLGGGMVRVHGTDKKLAFTSDVTPRYVKANPVEGGKQAVAEAYRNLCA VGAKPLATTDNLNFGNPEKPEIMGQFVGALKGIGEAVSALDMPIVSGNVSLYNETDGQAILPTPTIGAVGLVAAGEEPIL GEARDGHVLLLVGETIGHLGQSALLHEVFNREDGDAPAVDLEIEKRNGEFIRNNRDFIKACTDISDGGLALAAFELAEAA GVGVQIDASDTPTLFGEDQARYLVACNFDQAEALMIAAGQAGVPLETVGKFTGDTVKMGGSEATLEELSQIFRTSFAEAV A
Sequences:
>Translated_721_residues MQEPAITPEVIENHGLKPDEYDLILEIIGREPTFTELGIFSAMWNEHCSYKSSKKWLRTLPTSGPQVICGPGENAGIVDI GDGDAVVFKMESHNHPSYIEPYQGAATGVGGILRDVFTMGARPIASMNSLSFGEPAHHKTRQLVNGVVEGVGGYGNCFGV PCVGGEVRFHPAYNGNCLVNAFAAGLVKTDMIFYSAASGVGMPVVYLGAKTGRDGVGGATMASAEFDDTIEEKRPTVQVG DPFTEKRLMEATLELMQTGAVISIQDMGAAGLTCSAVEMGDKGGLGVRLDLEKVPQREENMTAYEMMLSESQERMLMVLK PELEAEAKAVFEKWDLDFAIVGETIAEDRFLIMHNGEVKADLPLSKLSSSAPEYDRPWIEVEAPAALTDADVPTIDPIDG LKALISSPNYAGKQWVYEQYDTTVMGDTARRPGLGGGMVRVHGTDKKLAFTSDVTPRYVKANPVEGGKQAVAEAYRNLCA VGAKPLATTDNLNFGNPEKPEIMGQFVGALKGIGEAVSALDMPIVSGNVSLYNETDGQAILPTPTIGAVGLVAAGEEPIL GEARDGHVLLLVGETIGHLGQSALLHEVFNREDGDAPAVDLEIEKRNGEFIRNNRDFIKACTDISDGGLALAAFELAEAA GVGVQIDASDTPTLFGEDQARYLVACNFDQAEALMIAAGQAGVPLETVGKFTGDTVKMGGSEATLEELSQIFRTSFAEAV A >Mature_721_residues MQEPAITPEVIENHGLKPDEYDLILEIIGREPTFTELGIFSAMWNEHCSYKSSKKWLRTLPTSGPQVICGPGENAGIVDI GDGDAVVFKMESHNHPSYIEPYQGAATGVGGILRDVFTMGARPIASMNSLSFGEPAHHKTRQLVNGVVEGVGGYGNCFGV PCVGGEVRFHPAYNGNCLVNAFAAGLVKTDMIFYSAASGVGMPVVYLGAKTGRDGVGGATMASAEFDDTIEEKRPTVQVG DPFTEKRLMEATLELMQTGAVISIQDMGAAGLTCSAVEMGDKGGLGVRLDLEKVPQREENMTAYEMMLSESQERMLMVLK PELEAEAKAVFEKWDLDFAIVGETIAEDRFLIMHNGEVKADLPLSKLSSSAPEYDRPWIEVEAPAALTDADVPTIDPIDG LKALISSPNYAGKQWVYEQYDTTVMGDTARRPGLGGGMVRVHGTDKKLAFTSDVTPRYVKANPVEGGKQAVAEAYRNLCA VGAKPLATTDNLNFGNPEKPEIMGQFVGALKGIGEAVSALDMPIVSGNVSLYNETDGQAILPTPTIGAVGLVAAGEEPIL GEARDGHVLLLVGETIGHLGQSALLHEVFNREDGDAPAVDLEIEKRNGEFIRNNRDFIKACTDISDGGLALAAFELAEAA GVGVQIDASDTPTLFGEDQARYLVACNFDQAEALMIAAGQAGVPLETVGKFTGDTVKMGGSEATLEELSQIFRTSFAEAV A
Specific function: Unknown
COG id: COG0046
COG function: function code F; Phosphoribosylformylglycinamidine (FGAM) synthase, synthetase domain
Gene ontology:
Cell location: Cytoplasm
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the FGAMS family
Homologues:
Organism=Escherichia coli, GI48994899, Length=743, Percent_Identity=24.764468371467, Blast_Score=120, Evalue=4e-28, Organism=Saccharomyces cerevisiae, GI6321498, Length=803, Percent_Identity=24.4084682440847, Blast_Score=135, Evalue=2e-32, Organism=Drosophila melanogaster, GI24582111, Length=647, Percent_Identity=23.0293663060278, Blast_Score=69, Evalue=1e-11, Organism=Drosophila melanogaster, GI24582109, Length=647, Percent_Identity=23.0293663060278, Blast_Score=69, Evalue=1e-11, Organism=Drosophila melanogaster, GI17137292, Length=647, Percent_Identity=23.0293663060278, Blast_Score=69, Evalue=1e-11,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): PURL_SILST (Q1GHL5)
Other databases:
- EMBL: CP000377 - RefSeq: YP_613113.1 - ProteinModelPortal: Q1GHL5 - SMR: Q1GHL5 - STRING: Q1GHL5 - GeneID: 4077239 - GenomeReviews: CP000377_GR - KEGG: sit:TM1040_1118 - NMPDR: fig|292414.1.peg.3747 - eggNOG: COG0046 - HOGENOM: HBG311214 - OMA: YGNSFGV - PhylomeDB: Q1GHL5 - ProtClustDB: PRK01213 - BioCyc: SSP292414:TM1040_1118-MONOMER - GO: GO:0005737 - HAMAP: MF_00420 - InterPro: IPR000728 - InterPro: IPR010918 - InterPro: IPR010074 - InterPro: IPR016188 - TIGRFAMs: TIGR01736
Pfam domain/function: PF00586 AIRS; PF02769 AIRS_C; SSF56042 AIR_synth_C; SSF55326 PurM_N-like
EC number: =6.3.5.3
Molecular weight: Translated: 76737; Mature: 76737
Theoretical pI: Translated: 4.30; Mature: 4.30
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.2 %Cys (Translated Protein) 3.3 %Met (Translated Protein) 4.6 %Cys+Met (Translated Protein) 1.2 %Cys (Mature Protein) 3.3 %Met (Mature Protein) 4.6 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MQEPAITPEVIENHGLKPDEYDLILEIIGREPTFTELGIFSAMWNEHCSYKSSKKWLRTL CCCCCCCHHHHHHCCCCCCHHHHHHHHHCCCCCHHHHHHHHHHHHHHCCCCHHHHHHHHC PTSGPQVICGPGENAGIVDIGDGDAVVFKMESHNHPSYIEPYQGAATGVGGILRDVFTMG CCCCCEEEECCCCCCCEEEECCCCEEEEEEECCCCCCCCCCCCCCHHHHHHHHHHHHHHC ARPIASMNSLSFGEPAHHKTRQLVNGVVEGVGGYGNCFGVPCVGGEVRFHPAYNGNCLVN CCCCCCCCCCCCCCCCHHHHHHHHHHHHHCCCCCCCEEECCCCCCEEEEECCCCCCEEHH AFAAGLVKTDMIFYSAASGVGMPVVYLGAKTGRDGVGGATMASAEFDDTIEEKRPTVQVG HHHHHHHHHHHHEEECCCCCCCCEEEEECCCCCCCCCCCEEECCCCHHHHHHCCCEEEEC DPFTEKRLMEATLELMQTGAVISIQDMGAAGLTCSAVEMGDKGGLGVRLDLEKVPQREEN CCHHHHHHHHHHHHHHHCCCEEEEECCCCCCCEEEEEEECCCCCCEEEEEHHHCCCCHHC MTAYEMMLSESQERMLMVLKPELEAEAKAVFEKWDLDFAIVGETIAEDRFLIMHNGEVKA HHHHHHHHHCCCCEEEEEECCCCHHHHHHHHHHHCCCEEEECCHHCCCCEEEEECCCEEE DLPLSKLSSSAPEYDRPWIEVEAPAALTDADVPTIDPIDGLKALISSPNYAGKQWVYEQY CCCHHHHHCCCCCCCCCEEEEECCCEECCCCCCCCCCHHHHHHHHCCCCCCCCHHHHHHC DTTVMGDTARRPGLGGGMVRVHGTDKKLAFTSDVTPRYVKANPVEGGKQAVAEAYRNLCA CCEEECCCCCCCCCCCCEEEEECCCCEEEEECCCCCCEEECCCCCCHHHHHHHHHHHHHH VGAKPLATTDNLNFGNPEKPEIMGQFVGALKGIGEAVSALDMPIVSGNVSLYNETDGQAI CCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHCCCEEECCEEEEECCCCCEE LPTPTIGAVGLVAAGEEPILGEARDGHVLLLVGETIGHLGQSALLHEVFNREDGDAPAVD CCCCCCCCEEEEECCCCCCCCCCCCCEEEEEECCHHHHHHHHHHHHHHHCCCCCCCCEEE LEIEKRNGEFIRNNRDFIKACTDISDGGLALAAFELAEAAGVGVQIDASDTPTLFGEDQA EEEECCCCCEECCCHHHHHHHCCCCCCCEEEHHHHHHHHCCCCEEEECCCCCCEECCCCC RYLVACNFDQAEALMIAAGQAGVPLETVGKFTGDTVKMGGSEATLEELSQIFRTSFAEAV CEEEEECCCCCCEEEEECCCCCCCHHHHHCCCCCEEEECCCHHHHHHHHHHHHHHHHHHC A C >Mature Secondary Structure MQEPAITPEVIENHGLKPDEYDLILEIIGREPTFTELGIFSAMWNEHCSYKSSKKWLRTL CCCCCCCHHHHHHCCCCCCHHHHHHHHHCCCCCHHHHHHHHHHHHHHCCCCHHHHHHHHC PTSGPQVICGPGENAGIVDIGDGDAVVFKMESHNHPSYIEPYQGAATGVGGILRDVFTMG CCCCCEEEECCCCCCCEEEECCCCEEEEEEECCCCCCCCCCCCCCHHHHHHHHHHHHHHC ARPIASMNSLSFGEPAHHKTRQLVNGVVEGVGGYGNCFGVPCVGGEVRFHPAYNGNCLVN CCCCCCCCCCCCCCCCHHHHHHHHHHHHHCCCCCCCEEECCCCCCEEEEECCCCCCEEHH AFAAGLVKTDMIFYSAASGVGMPVVYLGAKTGRDGVGGATMASAEFDDTIEEKRPTVQVG HHHHHHHHHHHHEEECCCCCCCCEEEEECCCCCCCCCCCEEECCCCHHHHHHCCCEEEEC DPFTEKRLMEATLELMQTGAVISIQDMGAAGLTCSAVEMGDKGGLGVRLDLEKVPQREEN CCHHHHHHHHHHHHHHHCCCEEEEECCCCCCCEEEEEEECCCCCCEEEEEHHHCCCCHHC MTAYEMMLSESQERMLMVLKPELEAEAKAVFEKWDLDFAIVGETIAEDRFLIMHNGEVKA HHHHHHHHHCCCCEEEEEECCCCHHHHHHHHHHHCCCEEEECCHHCCCCEEEEECCCEEE DLPLSKLSSSAPEYDRPWIEVEAPAALTDADVPTIDPIDGLKALISSPNYAGKQWVYEQY CCCHHHHHCCCCCCCCCEEEEECCCEECCCCCCCCCCHHHHHHHHCCCCCCCCHHHHHHC DTTVMGDTARRPGLGGGMVRVHGTDKKLAFTSDVTPRYVKANPVEGGKQAVAEAYRNLCA CCEEECCCCCCCCCCCCEEEEECCCCEEEEECCCCCCEEECCCCCCHHHHHHHHHHHHHH VGAKPLATTDNLNFGNPEKPEIMGQFVGALKGIGEAVSALDMPIVSGNVSLYNETDGQAI CCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHCCCEEECCEEEEECCCCCEE LPTPTIGAVGLVAAGEEPILGEARDGHVLLLVGETIGHLGQSALLHEVFNREDGDAPAVD CCCCCCCCEEEEECCCCCCCCCCCCCEEEEEECCHHHHHHHHHHHHHHHCCCCCCCCEEE LEIEKRNGEFIRNNRDFIKACTDISDGGLALAAFELAEAAGVGVQIDASDTPTLFGEDQA EEEECCCCCEECCCHHHHHHHCCCCCCCEEEHHHHHHHHCCCCEEEECCCCCCEECCCCC RYLVACNFDQAEALMIAAGQAGVPLETVGKFTGDTVKMGGSEATLEELSQIFRTSFAEAV CEEEEECCCCCCEEEEECCCCCCCHHHHHCCCCCEEEECCCHHHHHHHHHHHHHHHHHHC A C
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: NA