Definition Halothermothrix orenii H 168 chromosome, complete genome.
Accession NC_011899
Length 2,578,146

Click here to switch to the map view.

The map label for this gene is purL [H]

Identifier: 220933045

GI number: 220933045

Start: 2410137

End: 2412338

Strand: Reverse

Name: purL [H]

Synonym: Hore_22130

Alternate gene names: 220933045

Gene position: 2412338-2410137 (Counterclockwise)

Preceding gene: 220933046

Following gene: 220933044

Centisome position: 93.57

GC content: 46.68

Gene sequence:

>2202_bases
ATGAAATCCCGGGAACAACTATTAGAAAAGCTAAAATTTCACGGACTTACTGAAAAAGAGTATCACATGATTGTTGAAAA
ACTGGGGAGAGAGCCCAATGAACTGGAGCTGGGTCTTTTCGGGGTTATGTGGTCCGAACACTGTGGTTATAAAAATTCCA
AAGCAGTCTTAAGGAATTTCCCCACCGAAGGGGAGCAGGTCCTTCAGGGTCCGGGTGAGAATGCCGGTATAGTCGATATC
GGTGATAACAAGGCGGTTGTTTTTAAGATTGAGAGTCATAACCATCCGTCTGCCATTGAGCCTTATCAGGGAGCAGCGAC
CGGTGTTGGTGGTATAATCAGGGATATTTTTACCATGGGAGCCCGCCCTATAGCCTTACTTGATTCCCTCAGGTTTGGTC
CCCTTGATGAGGAACGGGTTCGATATATTTTTTCAGGGGTGGTCAGTGGGATCAGTGACTATGGGAATAGTATCGGGATC
CCCACCGTCGGTGGTGAGACTTATTTTCATAAAGCCTATAAAGGGAATCCTCTTGTAAATGCCATGTGTGTTGGTCTGGT
TGATCACAAAGATATCATAAAAGCTGTGGCCCGGGGTGTTGGAAACCCGGTTATGGTTGTTGGTGCAACCACAGGTCGGG
ATGGTATCCAGGGGGCCAGTTTTGCCTCCGAAGAACTGAGTGAAGATTCGGAGGAAAGGCGTCCCTCGGTTCAGGTTGGT
GACCCCTTTATGGAAAAACTGTTACTGGAGGCCTGCCTTGAATTATATAAGACCGATGCAGTGGTTGGTATCCAGGATAT
GGGGGCAGCAGGTCTGATAAGTTCTTCCTGTGAAATGGCAAGTCGGGCCGGTAGTGGTATGGAGCTGGATGTCAGCCAGG
TTCCCCTGCGTGAACCGGGCCTGACTCCTTATGAAATTATGTTATCGGAATCCCAGGAGAGAATGCTGGTTGTCCCTAAA
AAAGGGCGTGAAGATGAGGTTAAAAAGATCTTTAAACACTGGGGCCTTAATGCCCGGGTTATTGGCCGGGTAACCGATGA
CGGTATTTTAAGGATAAAAAATGGAGAAGATGTTGTGGCTGAAGTGCCAGCCCATTATCTGGCTGAGGCTCCCGAATATG
TCAGGGAAGGTAAGAGGCCTGCCTGGCTGGATGAGGAGAATAAACTGGATTTGGAGTCGTTACCACTCCCAGATGATTAT
AATAAAGTTTTGCTGGAAATGCTGGATTCACCAAACCTGGCCAGTAAGGAATGGATTTATAGTCAGTATGATCATATGGT
CCAGAACAATACAATGGTCTTACCCGGATCTGATGCAGCTGTTTTACGGATAAAGGGCACTGAACGGGCTATTGCGGTTA
CCACTGACTCCAACGGGCGCTATTTTTATCTTGACCCCAGGCAGGGGGGTAAACTGGCTGTGGCCGAGGCAGCCCGGAAT
ATAGTCTGCAGTGGTGGTCAGCCCCTGGCAATTACAGATGGTCTGAATTTCGGAAATCCCGAGAAAGAAGAAATTTACTG
GCAGTTCAAAGAGGCGGTGGCCGGAATCAGTGAGGCCTGCCTGGCCCTCGGCACACCGGTGGTTAGTGGTAATGTCAGCT
TTTATAATGAACACGAAGGAAAGGCCATTTATCCAACTCCAATTGTAGGTATGATTGGAGTACTGGAAAAGCAGGAGTAT
GCTACCGATATTGCTTTTAAAGATGAGGGAGATCTAGTTTACCTCATTGGAGAGACCAGAGAAGAACTTGGGGGCAGTGA
ATATTTATCGGTAATACACGATAAAGACAGGGGGTTACCCCCGACTCTTGACCTTGAAGAAGAAAAGAGGTTACAGTCAT
CTTTATTGACTCTTATCCAGGAGGGGTTAGTTAAGTCTGCCCATGATTGTGCCGAAGGTGGTCTGACTATAGCTCTTACT
GAATGTTGTCTCACCGGGGATCTCGGTGCCATAATTGAGCTGGGTGATTTCCAGATAAGGCCTGATGCGATGTTATTCGG
AGAATCGGCTTCCAGGGTATTGATAACAATTTCACCTGGAGATAAAGAAAAGGCGGAATCTGTTTTACAAGAATCTGGCT
TAAAATATAGAAATATCGGTAAAACGGGTGGGAACCGACTAATAATTGATAGTTATATTGACCTGGAGCTCACTGAAATA
AAAGATAGGTGGGAGAGGACAATACCATGCCATATGAAATAA

Upstream 100 bases:

>100_bases
TGCCCCATCCTGAAAGGGCCAGTGAAACCATTCTCGGTAATGGGAGTGACGATGGACTTAAAATATTTCAATCAATTCTT
AAGGCTGGTGGTGTGAAACT

Downstream 100 bases:

>100_bases
TGAGCGGAAAACCCAGGGAAGAGTGTGGTGTATTTGGTATTTTTTCACCGGACAGGAATGATGCCGGTAGTCTTATCTAC
CTCGGGTTGCATTCTTTACA

Product: phosphoribosylformylglycinamidine synthase II

Products: NA

Alternate protein names: Phosphoribosylformylglycinamidine synthase II; FGAM synthase II [H]

Number of amino acids: Translated: 733; Mature: 733

Protein sequence:

>733_residues
MKSREQLLEKLKFHGLTEKEYHMIVEKLGREPNELELGLFGVMWSEHCGYKNSKAVLRNFPTEGEQVLQGPGENAGIVDI
GDNKAVVFKIESHNHPSAIEPYQGAATGVGGIIRDIFTMGARPIALLDSLRFGPLDEERVRYIFSGVVSGISDYGNSIGI
PTVGGETYFHKAYKGNPLVNAMCVGLVDHKDIIKAVARGVGNPVMVVGATTGRDGIQGASFASEELSEDSEERRPSVQVG
DPFMEKLLLEACLELYKTDAVVGIQDMGAAGLISSSCEMASRAGSGMELDVSQVPLREPGLTPYEIMLSESQERMLVVPK
KGREDEVKKIFKHWGLNARVIGRVTDDGILRIKNGEDVVAEVPAHYLAEAPEYVREGKRPAWLDEENKLDLESLPLPDDY
NKVLLEMLDSPNLASKEWIYSQYDHMVQNNTMVLPGSDAAVLRIKGTERAIAVTTDSNGRYFYLDPRQGGKLAVAEAARN
IVCSGGQPLAITDGLNFGNPEKEEIYWQFKEAVAGISEACLALGTPVVSGNVSFYNEHEGKAIYPTPIVGMIGVLEKQEY
ATDIAFKDEGDLVYLIGETREELGGSEYLSVIHDKDRGLPPTLDLEEEKRLQSSLLTLIQEGLVKSAHDCAEGGLTIALT
ECCLTGDLGAIIELGDFQIRPDAMLFGESASRVLITISPGDKEKAESVLQESGLKYRNIGKTGGNRLIIDSYIDLELTEI
KDRWERTIPCHMK

Sequences:

>Translated_733_residues
MKSREQLLEKLKFHGLTEKEYHMIVEKLGREPNELELGLFGVMWSEHCGYKNSKAVLRNFPTEGEQVLQGPGENAGIVDI
GDNKAVVFKIESHNHPSAIEPYQGAATGVGGIIRDIFTMGARPIALLDSLRFGPLDEERVRYIFSGVVSGISDYGNSIGI
PTVGGETYFHKAYKGNPLVNAMCVGLVDHKDIIKAVARGVGNPVMVVGATTGRDGIQGASFASEELSEDSEERRPSVQVG
DPFMEKLLLEACLELYKTDAVVGIQDMGAAGLISSSCEMASRAGSGMELDVSQVPLREPGLTPYEIMLSESQERMLVVPK
KGREDEVKKIFKHWGLNARVIGRVTDDGILRIKNGEDVVAEVPAHYLAEAPEYVREGKRPAWLDEENKLDLESLPLPDDY
NKVLLEMLDSPNLASKEWIYSQYDHMVQNNTMVLPGSDAAVLRIKGTERAIAVTTDSNGRYFYLDPRQGGKLAVAEAARN
IVCSGGQPLAITDGLNFGNPEKEEIYWQFKEAVAGISEACLALGTPVVSGNVSFYNEHEGKAIYPTPIVGMIGVLEKQEY
ATDIAFKDEGDLVYLIGETREELGGSEYLSVIHDKDRGLPPTLDLEEEKRLQSSLLTLIQEGLVKSAHDCAEGGLTIALT
ECCLTGDLGAIIELGDFQIRPDAMLFGESASRVLITISPGDKEKAESVLQESGLKYRNIGKTGGNRLIIDSYIDLELTEI
KDRWERTIPCHMK
>Mature_733_residues
MKSREQLLEKLKFHGLTEKEYHMIVEKLGREPNELELGLFGVMWSEHCGYKNSKAVLRNFPTEGEQVLQGPGENAGIVDI
GDNKAVVFKIESHNHPSAIEPYQGAATGVGGIIRDIFTMGARPIALLDSLRFGPLDEERVRYIFSGVVSGISDYGNSIGI
PTVGGETYFHKAYKGNPLVNAMCVGLVDHKDIIKAVARGVGNPVMVVGATTGRDGIQGASFASEELSEDSEERRPSVQVG
DPFMEKLLLEACLELYKTDAVVGIQDMGAAGLISSSCEMASRAGSGMELDVSQVPLREPGLTPYEIMLSESQERMLVVPK
KGREDEVKKIFKHWGLNARVIGRVTDDGILRIKNGEDVVAEVPAHYLAEAPEYVREGKRPAWLDEENKLDLESLPLPDDY
NKVLLEMLDSPNLASKEWIYSQYDHMVQNNTMVLPGSDAAVLRIKGTERAIAVTTDSNGRYFYLDPRQGGKLAVAEAARN
IVCSGGQPLAITDGLNFGNPEKEEIYWQFKEAVAGISEACLALGTPVVSGNVSFYNEHEGKAIYPTPIVGMIGVLEKQEY
ATDIAFKDEGDLVYLIGETREELGGSEYLSVIHDKDRGLPPTLDLEEEKRLQSSLLTLIQEGLVKSAHDCAEGGLTIALT
ECCLTGDLGAIIELGDFQIRPDAMLFGESASRVLITISPGDKEKAESVLQESGLKYRNIGKTGGNRLIIDSYIDLELTEI
KDRWERTIPCHMK

Specific function: Unknown

COG id: COG0046

COG function: function code F; Phosphoribosylformylglycinamidine (FGAM) synthase, synthetase domain

Gene ontology:

Cell location: Cytoplasm [H]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the FGAMS family [H]

Homologues:

Organism=Homo sapiens, GI31657129, Length=731, Percent_Identity=25.0341997264022, Blast_Score=112, Evalue=1e-24,
Organism=Escherichia coli, GI48994899, Length=794, Percent_Identity=25.1889168765743, Blast_Score=144, Evalue=2e-35,
Organism=Caenorhabditis elegans, GI17553022, Length=777, Percent_Identity=21.6216216216216, Blast_Score=100, Evalue=2e-21,
Organism=Saccharomyces cerevisiae, GI6321498, Length=802, Percent_Identity=25.3117206982544, Blast_Score=127, Evalue=5e-30,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR000728
- InterPro:   IPR010918
- InterPro:   IPR010074
- InterPro:   IPR016188 [H]

Pfam domain/function: PF00586 AIRS; PF02769 AIRS_C [H]

EC number: =6.3.5.3 [H]

Molecular weight: Translated: 80311; Mature: 80311

Theoretical pI: Translated: 4.59; Mature: 4.59

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.4 %Cys     (Translated Protein)
2.5 %Met     (Translated Protein)
3.8 %Cys+Met (Translated Protein)
1.4 %Cys     (Mature Protein)
2.5 %Met     (Mature Protein)
3.8 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKSREQLLEKLKFHGLTEKEYHMIVEKLGREPNELELGLFGVMWSEHCGYKNSKAVLRNF
CCCHHHHHHHHHHCCCCHHHHHHHHHHHCCCCCCEEEEEEEEHHHHHCCCCCCHHHHHCC
PTEGEQVLQGPGENAGIVDIGDNKAVVFKIESHNHPSAIEPYQGAATGVGGIIRDIFTMG
CCCCHHHHCCCCCCCCEEEECCCCEEEEEEECCCCCCCCCCCCCCHHHHHHHHHHHHHCC
ARPIALLDSLRFGPLDEERVRYIFSGVVSGISDYGNSIGIPTVGGETYFHKAYKGNPLVN
CCHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCHHEECCCCCCCCHH
AMCVGLVDHKDIIKAVARGVGNPVMVVGATTGRDGIQGASFASEELSEDSEERRPSVQVG
HHHHHHCCHHHHHHHHHHCCCCCEEEEEECCCCCCCCCCCCCHHHHHCCHHHHCCCCEEC
DPFMEKLLLEACLELYKTDAVVGIQDMGAAGLISSSCEMASRAGSGMELDVSQVPLREPG
CHHHHHHHHHHHHHHHHCCCEEEHHHCCCHHHHHHHHHHHHHCCCCCEEEHHHCCCCCCC
LTPYEIMLSESQERMLVVPKKGREDEVKKIFKHWGLNARVIGRVTDDGILRIKNGEDVVA
CCHHEEEECCCCCCEEEECCCCCHHHHHHHHHHCCCCEEEEEEECCCCEEEECCCCCHHH
EVPAHYLAEAPEYVREGKRPAWLDEENKLDLESLPLPDDYNKVLLEMLDSPNLASKEWIY
HCCHHHHHCCHHHHHCCCCCCCCCCCCCCCHHCCCCCCHHHHHHHHHHCCCCCCCHHHHH
SQYDHMVQNNTMVLPGSDAAVLRIKGTERAIAVTTDSNGRYFYLDPRQGGKLAVAEAARN
HHHHHHHCCCEEEECCCCEEEEEEECCCEEEEEEECCCCEEEEECCCCCCCEEHHHHHCC
IVCSGGQPLAITDGLNFGNPEKEEIYWQFKEAVAGISEACLALGTPVVSGNVSFYNEHEG
EEECCCCCEEEECCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHCCCEEECCEEEEECCCC
KAIYPTPIVGMIGVLEKQEYATDIAFKDEGDLVYLIGETREELGGSEYLSVIHDKDRGLP
CEECCCCHHHHHHHHHHHHHHHCCEEECCCCEEEEECCCHHHCCCHHHHHHHCCCCCCCC
PTLDLEEEKRLQSSLLTLIQEGLVKSAHDCAEGGLTIALTECCLTGDLGAIIELGDFQIR
CCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCEEEEEEHHHHCCCCCCEEEECCEEEC
PDAMLFGESASRVLITISPGDKEKAESVLQESGLKYRNIGKTGGNRLIIDSYIDLELTEI
CCCEEECCCCCEEEEEECCCCHHHHHHHHHHCCCEEEECCCCCCCEEEEECCCCEEHHHH
KDRWERTIPCHMK
HHHHHCCCCCCCC
>Mature Secondary Structure
MKSREQLLEKLKFHGLTEKEYHMIVEKLGREPNELELGLFGVMWSEHCGYKNSKAVLRNF
CCCHHHHHHHHHHCCCCHHHHHHHHHHHCCCCCCEEEEEEEEHHHHHCCCCCCHHHHHCC
PTEGEQVLQGPGENAGIVDIGDNKAVVFKIESHNHPSAIEPYQGAATGVGGIIRDIFTMG
CCCCHHHHCCCCCCCCEEEECCCCEEEEEEECCCCCCCCCCCCCCHHHHHHHHHHHHHCC
ARPIALLDSLRFGPLDEERVRYIFSGVVSGISDYGNSIGIPTVGGETYFHKAYKGNPLVN
CCHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCHHEECCCCCCCCHH
AMCVGLVDHKDIIKAVARGVGNPVMVVGATTGRDGIQGASFASEELSEDSEERRPSVQVG
HHHHHHCCHHHHHHHHHHCCCCCEEEEEECCCCCCCCCCCCCHHHHHCCHHHHCCCCEEC
DPFMEKLLLEACLELYKTDAVVGIQDMGAAGLISSSCEMASRAGSGMELDVSQVPLREPG
CHHHHHHHHHHHHHHHHCCCEEEHHHCCCHHHHHHHHHHHHHCCCCCEEEHHHCCCCCCC
LTPYEIMLSESQERMLVVPKKGREDEVKKIFKHWGLNARVIGRVTDDGILRIKNGEDVVA
CCHHEEEECCCCCCEEEECCCCCHHHHHHHHHHCCCCEEEEEEECCCCEEEECCCCCHHH
EVPAHYLAEAPEYVREGKRPAWLDEENKLDLESLPLPDDYNKVLLEMLDSPNLASKEWIY
HCCHHHHHCCHHHHHCCCCCCCCCCCCCCCHHCCCCCCHHHHHHHHHHCCCCCCCHHHHH
SQYDHMVQNNTMVLPGSDAAVLRIKGTERAIAVTTDSNGRYFYLDPRQGGKLAVAEAARN
HHHHHHHCCCEEEECCCCEEEEEEECCCEEEEEEECCCCEEEEECCCCCCCEEHHHHHCC
IVCSGGQPLAITDGLNFGNPEKEEIYWQFKEAVAGISEACLALGTPVVSGNVSFYNEHEG
EEECCCCCEEEECCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHCCCEEECCEEEEECCCC
KAIYPTPIVGMIGVLEKQEYATDIAFKDEGDLVYLIGETREELGGSEYLSVIHDKDRGLP
CEECCCCHHHHHHHHHHHHHHHCCEEECCCCEEEEECCCHHHCCCHHHHHHHCCCCCCCC
PTLDLEEEKRLQSSLLTLIQEGLVKSAHDCAEGGLTIALTECCLTGDLGAIIELGDFQIR
CCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCEEEEEEHHHHCCCCCCEEEECCEEEC
PDAMLFGESASRVLITISPGDKEKAESVLQESGLKYRNIGKTGGNRLIIDSYIDLELTEI
CCCEEECCCCCEEEEEECCCCHHHHHHHHHHCCCEEEECCCCCCCEEEEECCCCEEHHHH
KDRWERTIPCHMK
HHHHHCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA