Definition Ruegeria sp. TM1040, complete genome.
Accession NC_008044
Length 3,200,938

Click here to switch to the map view.

The map label for this gene is purL

Identifier: 99080959

GI number: 99080959

Start: 1199601

End: 1201766

Strand: Reverse

Name: purL

Synonym: TM1040_1118

Alternate gene names: 99080959

Gene position: 1201766-1199601 (Counterclockwise)

Preceding gene: 99080960

Following gene: 99080958

Centisome position: 37.54

GC content: 61.31

Gene sequence:

>2166_bases
ATGCAGGAACCAGCCATTACGCCTGAAGTGATCGAAAACCACGGACTGAAGCCCGATGAATACGATCTGATCCTCGAGAT
CATCGGCCGCGAGCCGACCTTCACCGAGCTCGGCATTTTCTCCGCCATGTGGAACGAGCACTGTTCCTATAAATCATCGA
AAAAATGGCTGCGCACCCTGCCGACCTCCGGCCCGCAGGTGATCTGCGGCCCCGGCGAGAACGCCGGCATCGTGGACATC
GGCGATGGCGATGCGGTCGTCTTCAAGATGGAAAGCCACAACCACCCCTCCTACATCGAGCCCTATCAAGGTGCCGCCAC
TGGTGTTGGCGGCATTTTGCGTGATGTCTTCACCATGGGCGCGCGGCCTATCGCGTCGATGAATTCGCTGTCCTTTGGTG
AGCCTGCGCATCACAAGACCCGCCAATTGGTAAACGGCGTGGTTGAGGGCGTCGGCGGCTACGGCAACTGTTTTGGTGTG
CCTTGTGTCGGCGGCGAAGTGCGCTTTCACCCCGCCTACAATGGCAACTGCCTGGTGAACGCCTTTGCGGCAGGCCTCGT
AAAAACCGACATGATCTTCTACTCCGCCGCCTCCGGTGTGGGCATGCCCGTTGTGTACCTCGGCGCCAAGACCGGCCGCG
ACGGGGTTGGTGGTGCAACCATGGCGTCGGCAGAATTCGACGACACCATCGAAGAAAAGCGCCCCACCGTGCAGGTTGGT
GACCCGTTCACCGAAAAACGCCTGATGGAAGCCACGCTGGAGCTGATGCAGACCGGTGCCGTGATCTCCATTCAGGACAT
GGGCGCGGCAGGCCTCACCTGCTCCGCTGTGGAAATGGGTGACAAGGGCGGCCTTGGCGTGCGTCTGGATCTGGAAAAGG
TTCCGCAGCGCGAAGAAAACATGACCGCTTACGAGATGATGCTCTCGGAATCGCAAGAGCGCATGCTGATGGTGCTGAAG
CCCGAGCTGGAGGCCGAGGCCAAAGCCGTCTTTGAGAAATGGGACCTCGATTTTGCCATAGTGGGTGAGACCATTGCCGA
AGATCGCTTCCTCATCATGCACAACGGCGAGGTCAAAGCGGATCTGCCGCTGTCAAAGCTTTCGTCCTCGGCGCCGGAAT
ACGACCGCCCGTGGATCGAGGTCGAGGCCCCCGCGGCGCTTACGGATGCGGATGTGCCGACCATTGACCCGATCGACGGC
CTGAAGGCGCTGATCTCCAGCCCCAACTATGCCGGCAAACAGTGGGTCTATGAGCAATATGACACCACCGTGATGGGCGA
CACCGCGCGTCGTCCGGGTCTGGGTGGCGGCATGGTCCGCGTGCATGGCACCGACAAGAAACTGGCCTTTACCTCTGACG
TGACCCCGCGTTACGTCAAGGCGAACCCGGTTGAGGGCGGCAAACAGGCCGTGGCCGAAGCCTATCGCAACCTCTGCGCT
GTCGGGGCCAAGCCATTGGCGACCACCGACAACCTCAATTTCGGCAACCCCGAAAAGCCCGAGATCATGGGCCAATTTGT
CGGCGCACTCAAAGGCATCGGCGAGGCGGTCTCGGCGCTTGATATGCCAATCGTCTCGGGCAACGTCTCGCTTTACAACG
AAACAGACGGCCAGGCGATCCTGCCGACACCGACCATTGGCGCGGTAGGTCTGGTTGCGGCGGGCGAAGAGCCGATCCTG
GGCGAGGCCCGCGACGGTCATGTGCTGCTGCTGGTGGGCGAAACCATTGGTCATCTTGGCCAGTCGGCGCTTCTGCACGA
GGTCTTCAACCGCGAGGACGGCGACGCCCCCGCAGTGGATCTTGAGATCGAAAAGCGCAACGGCGAGTTCATCCGCAACA
ACCGCGATTTCATCAAGGCCTGCACCGACATCAGCGACGGTGGGCTTGCGCTCGCGGCGTTTGAGCTTGCAGAGGCCGCA
GGCGTAGGGGTGCAGATCGACGCCAGCGACACCCCGACGCTCTTTGGTGAGGATCAGGCACGCTATCTGGTGGCCTGCAA
CTTCGACCAGGCCGAGGCGCTGATGATCGCTGCCGGTCAGGCCGGGGTGCCGCTTGAGACCGTTGGCAAGTTTACCGGCG
ACACGGTGAAGATGGGCGGATCGGAGGCAACGCTCGAAGAGCTGAGCCAGATCTTCCGCACGAGCTTTGCCGAAGCAGTC
GCCTAA

Upstream 100 bases:

>100_bases
TGAGGCAATCTCTGCACGCCTCTCATGCCCCCTTTCCCCGCAGCGGGGCTTGCTCTAAAAGGCCGACAACATGAAGCGAC
CCGGGGGGCCATCTAGCGCC

Downstream 100 bases:

>100_bases
TCACAAAAGGCGGGGACACTCCCGCGCCCGGAGGGGCCTTAGCTGTTGCTAAGCCCCCTTGGCGGCCTTGGGCCCGGCAC
CGCGCCTGCGCGGTGCCGGG

Product: phosphoribosylformylglycinamidine synthase II

Products: NA

Alternate protein names: Phosphoribosylformylglycinamidine synthase II; FGAM synthase II

Number of amino acids: Translated: 721; Mature: 721

Protein sequence:

>721_residues
MQEPAITPEVIENHGLKPDEYDLILEIIGREPTFTELGIFSAMWNEHCSYKSSKKWLRTLPTSGPQVICGPGENAGIVDI
GDGDAVVFKMESHNHPSYIEPYQGAATGVGGILRDVFTMGARPIASMNSLSFGEPAHHKTRQLVNGVVEGVGGYGNCFGV
PCVGGEVRFHPAYNGNCLVNAFAAGLVKTDMIFYSAASGVGMPVVYLGAKTGRDGVGGATMASAEFDDTIEEKRPTVQVG
DPFTEKRLMEATLELMQTGAVISIQDMGAAGLTCSAVEMGDKGGLGVRLDLEKVPQREENMTAYEMMLSESQERMLMVLK
PELEAEAKAVFEKWDLDFAIVGETIAEDRFLIMHNGEVKADLPLSKLSSSAPEYDRPWIEVEAPAALTDADVPTIDPIDG
LKALISSPNYAGKQWVYEQYDTTVMGDTARRPGLGGGMVRVHGTDKKLAFTSDVTPRYVKANPVEGGKQAVAEAYRNLCA
VGAKPLATTDNLNFGNPEKPEIMGQFVGALKGIGEAVSALDMPIVSGNVSLYNETDGQAILPTPTIGAVGLVAAGEEPIL
GEARDGHVLLLVGETIGHLGQSALLHEVFNREDGDAPAVDLEIEKRNGEFIRNNRDFIKACTDISDGGLALAAFELAEAA
GVGVQIDASDTPTLFGEDQARYLVACNFDQAEALMIAAGQAGVPLETVGKFTGDTVKMGGSEATLEELSQIFRTSFAEAV
A

Sequences:

>Translated_721_residues
MQEPAITPEVIENHGLKPDEYDLILEIIGREPTFTELGIFSAMWNEHCSYKSSKKWLRTLPTSGPQVICGPGENAGIVDI
GDGDAVVFKMESHNHPSYIEPYQGAATGVGGILRDVFTMGARPIASMNSLSFGEPAHHKTRQLVNGVVEGVGGYGNCFGV
PCVGGEVRFHPAYNGNCLVNAFAAGLVKTDMIFYSAASGVGMPVVYLGAKTGRDGVGGATMASAEFDDTIEEKRPTVQVG
DPFTEKRLMEATLELMQTGAVISIQDMGAAGLTCSAVEMGDKGGLGVRLDLEKVPQREENMTAYEMMLSESQERMLMVLK
PELEAEAKAVFEKWDLDFAIVGETIAEDRFLIMHNGEVKADLPLSKLSSSAPEYDRPWIEVEAPAALTDADVPTIDPIDG
LKALISSPNYAGKQWVYEQYDTTVMGDTARRPGLGGGMVRVHGTDKKLAFTSDVTPRYVKANPVEGGKQAVAEAYRNLCA
VGAKPLATTDNLNFGNPEKPEIMGQFVGALKGIGEAVSALDMPIVSGNVSLYNETDGQAILPTPTIGAVGLVAAGEEPIL
GEARDGHVLLLVGETIGHLGQSALLHEVFNREDGDAPAVDLEIEKRNGEFIRNNRDFIKACTDISDGGLALAAFELAEAA
GVGVQIDASDTPTLFGEDQARYLVACNFDQAEALMIAAGQAGVPLETVGKFTGDTVKMGGSEATLEELSQIFRTSFAEAV
A
>Mature_721_residues
MQEPAITPEVIENHGLKPDEYDLILEIIGREPTFTELGIFSAMWNEHCSYKSSKKWLRTLPTSGPQVICGPGENAGIVDI
GDGDAVVFKMESHNHPSYIEPYQGAATGVGGILRDVFTMGARPIASMNSLSFGEPAHHKTRQLVNGVVEGVGGYGNCFGV
PCVGGEVRFHPAYNGNCLVNAFAAGLVKTDMIFYSAASGVGMPVVYLGAKTGRDGVGGATMASAEFDDTIEEKRPTVQVG
DPFTEKRLMEATLELMQTGAVISIQDMGAAGLTCSAVEMGDKGGLGVRLDLEKVPQREENMTAYEMMLSESQERMLMVLK
PELEAEAKAVFEKWDLDFAIVGETIAEDRFLIMHNGEVKADLPLSKLSSSAPEYDRPWIEVEAPAALTDADVPTIDPIDG
LKALISSPNYAGKQWVYEQYDTTVMGDTARRPGLGGGMVRVHGTDKKLAFTSDVTPRYVKANPVEGGKQAVAEAYRNLCA
VGAKPLATTDNLNFGNPEKPEIMGQFVGALKGIGEAVSALDMPIVSGNVSLYNETDGQAILPTPTIGAVGLVAAGEEPIL
GEARDGHVLLLVGETIGHLGQSALLHEVFNREDGDAPAVDLEIEKRNGEFIRNNRDFIKACTDISDGGLALAAFELAEAA
GVGVQIDASDTPTLFGEDQARYLVACNFDQAEALMIAAGQAGVPLETVGKFTGDTVKMGGSEATLEELSQIFRTSFAEAV
A

Specific function: Unknown

COG id: COG0046

COG function: function code F; Phosphoribosylformylglycinamidine (FGAM) synthase, synthetase domain

Gene ontology:

Cell location: Cytoplasm

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the FGAMS family

Homologues:

Organism=Escherichia coli, GI48994899, Length=743, Percent_Identity=24.764468371467, Blast_Score=120, Evalue=4e-28,
Organism=Saccharomyces cerevisiae, GI6321498, Length=803, Percent_Identity=24.4084682440847, Blast_Score=135, Evalue=2e-32,
Organism=Drosophila melanogaster, GI24582111, Length=647, Percent_Identity=23.0293663060278, Blast_Score=69, Evalue=1e-11,
Organism=Drosophila melanogaster, GI24582109, Length=647, Percent_Identity=23.0293663060278, Blast_Score=69, Evalue=1e-11,
Organism=Drosophila melanogaster, GI17137292, Length=647, Percent_Identity=23.0293663060278, Blast_Score=69, Evalue=1e-11,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): PURL_SILST (Q1GHL5)

Other databases:

- EMBL:   CP000377
- RefSeq:   YP_613113.1
- ProteinModelPortal:   Q1GHL5
- SMR:   Q1GHL5
- STRING:   Q1GHL5
- GeneID:   4077239
- GenomeReviews:   CP000377_GR
- KEGG:   sit:TM1040_1118
- NMPDR:   fig|292414.1.peg.3747
- eggNOG:   COG0046
- HOGENOM:   HBG311214
- OMA:   YGNSFGV
- PhylomeDB:   Q1GHL5
- ProtClustDB:   PRK01213
- BioCyc:   SSP292414:TM1040_1118-MONOMER
- GO:   GO:0005737
- HAMAP:   MF_00420
- InterPro:   IPR000728
- InterPro:   IPR010918
- InterPro:   IPR010074
- InterPro:   IPR016188
- TIGRFAMs:   TIGR01736

Pfam domain/function: PF00586 AIRS; PF02769 AIRS_C; SSF56042 AIR_synth_C; SSF55326 PurM_N-like

EC number: =6.3.5.3

Molecular weight: Translated: 76737; Mature: 76737

Theoretical pI: Translated: 4.30; Mature: 4.30

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.2 %Cys     (Translated Protein)
3.3 %Met     (Translated Protein)
4.6 %Cys+Met (Translated Protein)
1.2 %Cys     (Mature Protein)
3.3 %Met     (Mature Protein)
4.6 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MQEPAITPEVIENHGLKPDEYDLILEIIGREPTFTELGIFSAMWNEHCSYKSSKKWLRTL
CCCCCCCHHHHHHCCCCCCHHHHHHHHHCCCCCHHHHHHHHHHHHHHCCCCHHHHHHHHC
PTSGPQVICGPGENAGIVDIGDGDAVVFKMESHNHPSYIEPYQGAATGVGGILRDVFTMG
CCCCCEEEECCCCCCCEEEECCCCEEEEEEECCCCCCCCCCCCCCHHHHHHHHHHHHHHC
ARPIASMNSLSFGEPAHHKTRQLVNGVVEGVGGYGNCFGVPCVGGEVRFHPAYNGNCLVN
CCCCCCCCCCCCCCCCHHHHHHHHHHHHHCCCCCCCEEECCCCCCEEEEECCCCCCEEHH
AFAAGLVKTDMIFYSAASGVGMPVVYLGAKTGRDGVGGATMASAEFDDTIEEKRPTVQVG
HHHHHHHHHHHHEEECCCCCCCCEEEEECCCCCCCCCCCEEECCCCHHHHHHCCCEEEEC
DPFTEKRLMEATLELMQTGAVISIQDMGAAGLTCSAVEMGDKGGLGVRLDLEKVPQREEN
CCHHHHHHHHHHHHHHHCCCEEEEECCCCCCCEEEEEEECCCCCCEEEEEHHHCCCCHHC
MTAYEMMLSESQERMLMVLKPELEAEAKAVFEKWDLDFAIVGETIAEDRFLIMHNGEVKA
HHHHHHHHHCCCCEEEEEECCCCHHHHHHHHHHHCCCEEEECCHHCCCCEEEEECCCEEE
DLPLSKLSSSAPEYDRPWIEVEAPAALTDADVPTIDPIDGLKALISSPNYAGKQWVYEQY
CCCHHHHHCCCCCCCCCEEEEECCCEECCCCCCCCCCHHHHHHHHCCCCCCCCHHHHHHC
DTTVMGDTARRPGLGGGMVRVHGTDKKLAFTSDVTPRYVKANPVEGGKQAVAEAYRNLCA
CCEEECCCCCCCCCCCCEEEEECCCCEEEEECCCCCCEEECCCCCCHHHHHHHHHHHHHH
VGAKPLATTDNLNFGNPEKPEIMGQFVGALKGIGEAVSALDMPIVSGNVSLYNETDGQAI
CCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHCCCEEECCEEEEECCCCCEE
LPTPTIGAVGLVAAGEEPILGEARDGHVLLLVGETIGHLGQSALLHEVFNREDGDAPAVD
CCCCCCCCEEEEECCCCCCCCCCCCCEEEEEECCHHHHHHHHHHHHHHHCCCCCCCCEEE
LEIEKRNGEFIRNNRDFIKACTDISDGGLALAAFELAEAAGVGVQIDASDTPTLFGEDQA
EEEECCCCCEECCCHHHHHHHCCCCCCCEEEHHHHHHHHCCCCEEEECCCCCCEECCCCC
RYLVACNFDQAEALMIAAGQAGVPLETVGKFTGDTVKMGGSEATLEELSQIFRTSFAEAV
CEEEEECCCCCCEEEEECCCCCCCHHHHHCCCCCEEEECCCHHHHHHHHHHHHHHHHHHC
A
C
>Mature Secondary Structure
MQEPAITPEVIENHGLKPDEYDLILEIIGREPTFTELGIFSAMWNEHCSYKSSKKWLRTL
CCCCCCCHHHHHHCCCCCCHHHHHHHHHCCCCCHHHHHHHHHHHHHHCCCCHHHHHHHHC
PTSGPQVICGPGENAGIVDIGDGDAVVFKMESHNHPSYIEPYQGAATGVGGILRDVFTMG
CCCCCEEEECCCCCCCEEEECCCCEEEEEEECCCCCCCCCCCCCCHHHHHHHHHHHHHHC
ARPIASMNSLSFGEPAHHKTRQLVNGVVEGVGGYGNCFGVPCVGGEVRFHPAYNGNCLVN
CCCCCCCCCCCCCCCCHHHHHHHHHHHHHCCCCCCCEEECCCCCCEEEEECCCCCCEEHH
AFAAGLVKTDMIFYSAASGVGMPVVYLGAKTGRDGVGGATMASAEFDDTIEEKRPTVQVG
HHHHHHHHHHHHEEECCCCCCCCEEEEECCCCCCCCCCCEEECCCCHHHHHHCCCEEEEC
DPFTEKRLMEATLELMQTGAVISIQDMGAAGLTCSAVEMGDKGGLGVRLDLEKVPQREEN
CCHHHHHHHHHHHHHHHCCCEEEEECCCCCCCEEEEEEECCCCCCEEEEEHHHCCCCHHC
MTAYEMMLSESQERMLMVLKPELEAEAKAVFEKWDLDFAIVGETIAEDRFLIMHNGEVKA
HHHHHHHHHCCCCEEEEEECCCCHHHHHHHHHHHCCCEEEECCHHCCCCEEEEECCCEEE
DLPLSKLSSSAPEYDRPWIEVEAPAALTDADVPTIDPIDGLKALISSPNYAGKQWVYEQY
CCCHHHHHCCCCCCCCCEEEEECCCEECCCCCCCCCCHHHHHHHHCCCCCCCCHHHHHHC
DTTVMGDTARRPGLGGGMVRVHGTDKKLAFTSDVTPRYVKANPVEGGKQAVAEAYRNLCA
CCEEECCCCCCCCCCCCEEEEECCCCEEEEECCCCCCEEECCCCCCHHHHHHHHHHHHHH
VGAKPLATTDNLNFGNPEKPEIMGQFVGALKGIGEAVSALDMPIVSGNVSLYNETDGQAI
CCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHCCCEEECCEEEEECCCCCEE
LPTPTIGAVGLVAAGEEPILGEARDGHVLLLVGETIGHLGQSALLHEVFNREDGDAPAVD
CCCCCCCCEEEEECCCCCCCCCCCCCEEEEEECCHHHHHHHHHHHHHHHCCCCCCCCEEE
LEIEKRNGEFIRNNRDFIKACTDISDGGLALAAFELAEAAGVGVQIDASDTPTLFGEDQA
EEEECCCCCEECCCHHHHHHHCCCCCCCEEEHHHHHHHHCCCCEEEECCCCCCEECCCCC
RYLVACNFDQAEALMIAAGQAGVPLETVGKFTGDTVKMGGSEATLEELSQIFRTSFAEAV
CEEEEECCCCCCEEEEECCCCCCCHHHHHCCCCCEEEECCCHHHHHHHHHHHHHHHHHHC
A
C

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA