| Definition | Halothermothrix orenii H 168 chromosome, complete genome. |
|---|---|
| Accession | NC_011899 |
| Length | 2,578,146 |
Click here to switch to the map view.
The map label for this gene is purB [H]
Identifier: 220933049
GI number: 220933049
Start: 2414172
End: 2415560
Strand: Reverse
Name: purB [H]
Synonym: Hore_22170
Alternate gene names: 220933049
Gene position: 2415560-2414172 (Counterclockwise)
Preceding gene: 220933050
Following gene: 220933048
Centisome position: 93.69
GC content: 44.28
Gene sequence:
>1389_bases ATGGAACGAAATATTTTTGAAAATATCTGTCCACTTGATCACCGATATTCTTTAAAAAAAGATCTGTTTAATGACCTCGG CAAATACTTTTCGGAAAAGGCTACAATTTATTTTCAGGCTAGAGTTGAGCTGGCCCTGGTTAAGGCCCTGGCCGGGCGTG GGGTATGTAGTTTTGATGTGGTTAAGGAGGTTGAAGAGGCTGTTAAAGGGATAAAGGTAGGGGAAGTATATGAAGAAGAG GCCCGGACCAGGCATAATATAAGGGCTCTTGTTAACTGTATTCGAAAGAAAATAAGTGCTGAGGCCCGTCCCTTTGTCCA TCTTTCGGCAACTTCCTTTGATATTGTAGATACGGCCAATAGCCTTCGATATAAAGAAGCTACAGAAAAATTGATTGTAC CGGCACTGGAGCGGTTACTGGAGCAGTGGCTTAATCTGGCCGAACAGGAAAGGGATACACTCCAGATTGGCCGTACCCAC GGGCAGCATGCTGAACCCCTTACCTTTGGGCTGGTTATGGCTTATTATGCCAGCCGGCTTCATGAGCGGATTGTTAACCT GGAGAAGGTGGTTTCCAGCCTGTGTGGTAAGATGGCCGGGGCGGTAGGAGCCTATAATGCCAGCAGTCTATTTTTTGAAG ATCCGGAAGAATTCGAAAAAGAAGTATTAAAGGAACTGGGCCTGAAGCCCGCTCCCGTTTCCACCCAGATAGTCCCTCCC GAATATATGACCGACTATGTCCATTCCCTGATTACTGTTTTTGGGGTTCTGGCTGACTTCAGTGATGATATGAGGCACCT GCAGAGGACAGAAATAGGGGAAACAGGGGAGTATTTTGCTAAAGACCAGGTCGGTTCTTCGACCATGCCCCATAAAAGAA ACCCCATTAATTATGAGAATGTTAAAAGCATGTGGAAAACCTTTATGCCCCGGATGGTGACCATGTATCTGGATCAGCTT TCTGAACACCAGAGAGATCTAACCAATTCAGCCTCAGGTCGTTTTATTGCTGAAATAGCCTCAGGATTAATGATGACGGT AGACCGGCTGTATAAAGTATCTTCACGGATGAAAATTAATTCCCGGAAAATGAAGAATAATTTTAACTTAAGTAAAAATA TGATAATTGCTGAACCACTCTATATATTCCTGGCAGCTGCTGGCCACCCCGATGCCCATGAATATGTAAGAAAACTTACC CTGAAGGCTGATAAAGAGGGTAAGGATCTGGTTGAATTAATTAAAGCCGACAAAGAAATTGAAACCTACCTGGCTAAACT CGATAAACGCCAGAAGGATATTCTCTATAATCCGGAGCAGTATACCGGTATTGCCCGGGAAAGGACTGAAGAGATTGTGA CTAAAATCAGGAAGGAGAGGGGTTTGTAA
Upstream 100 bases:
>100_bases ATTTATAATGGCTATCGTTCATGGTTGTCTGGTAAGGATTTTCAGACAATATTATTTCATTCTTATCATATTACAGGTTT TCAGGGAAAGGGAGGGTATA
Downstream 100 bases:
>100_bases TGTTAACAAAACTGGAAATGCTTTATGAAGGAAAGGCTAAAAAGGTTTATCGGACCGAGGACAAAGACAGGGTTATTATT GAGTATAAGGATGATGCTAC
Product: adenylosuccinate lyase
Products: NA
Alternate protein names: ASL; Adenylosuccinase; ASase [H]
Number of amino acids: Translated: 462; Mature: 462
Protein sequence:
>462_residues MERNIFENICPLDHRYSLKKDLFNDLGKYFSEKATIYFQARVELALVKALAGRGVCSFDVVKEVEEAVKGIKVGEVYEEE ARTRHNIRALVNCIRKKISAEARPFVHLSATSFDIVDTANSLRYKEATEKLIVPALERLLEQWLNLAEQERDTLQIGRTH GQHAEPLTFGLVMAYYASRLHERIVNLEKVVSSLCGKMAGAVGAYNASSLFFEDPEEFEKEVLKELGLKPAPVSTQIVPP EYMTDYVHSLITVFGVLADFSDDMRHLQRTEIGETGEYFAKDQVGSSTMPHKRNPINYENVKSMWKTFMPRMVTMYLDQL SEHQRDLTNSASGRFIAEIASGLMMTVDRLYKVSSRMKINSRKMKNNFNLSKNMIIAEPLYIFLAAAGHPDAHEYVRKLT LKADKEGKDLVELIKADKEIETYLAKLDKRQKDILYNPEQYTGIARERTEEIVTKIRKERGL
Sequences:
>Translated_462_residues MERNIFENICPLDHRYSLKKDLFNDLGKYFSEKATIYFQARVELALVKALAGRGVCSFDVVKEVEEAVKGIKVGEVYEEE ARTRHNIRALVNCIRKKISAEARPFVHLSATSFDIVDTANSLRYKEATEKLIVPALERLLEQWLNLAEQERDTLQIGRTH GQHAEPLTFGLVMAYYASRLHERIVNLEKVVSSLCGKMAGAVGAYNASSLFFEDPEEFEKEVLKELGLKPAPVSTQIVPP EYMTDYVHSLITVFGVLADFSDDMRHLQRTEIGETGEYFAKDQVGSSTMPHKRNPINYENVKSMWKTFMPRMVTMYLDQL SEHQRDLTNSASGRFIAEIASGLMMTVDRLYKVSSRMKINSRKMKNNFNLSKNMIIAEPLYIFLAAAGHPDAHEYVRKLT LKADKEGKDLVELIKADKEIETYLAKLDKRQKDILYNPEQYTGIARERTEEIVTKIRKERGL >Mature_462_residues MERNIFENICPLDHRYSLKKDLFNDLGKYFSEKATIYFQARVELALVKALAGRGVCSFDVVKEVEEAVKGIKVGEVYEEE ARTRHNIRALVNCIRKKISAEARPFVHLSATSFDIVDTANSLRYKEATEKLIVPALERLLEQWLNLAEQERDTLQIGRTH GQHAEPLTFGLVMAYYASRLHERIVNLEKVVSSLCGKMAGAVGAYNASSLFFEDPEEFEKEVLKELGLKPAPVSTQIVPP EYMTDYVHSLITVFGVLADFSDDMRHLQRTEIGETGEYFAKDQVGSSTMPHKRNPINYENVKSMWKTFMPRMVTMYLDQL SEHQRDLTNSASGRFIAEIASGLMMTVDRLYKVSSRMKINSRKMKNNFNLSKNMIIAEPLYIFLAAAGHPDAHEYVRKLT LKADKEGKDLVELIKADKEIETYLAKLDKRQKDILYNPEQYTGIARERTEEIVTKIRKERGL
Specific function: De novo purine biosynthesis; eighth step. [C]
COG id: COG0015
COG function: function code F; Adenylosuccinate lyase
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the lyase 1 family. Adenylosuccinate lyase subfamily [H]
Homologues:
Organism=Homo sapiens, GI4557269, Length=470, Percent_Identity=25.3191489361702, Blast_Score=101, Evalue=2e-21, Organism=Homo sapiens, GI183227688, Length=388, Percent_Identity=25.2577319587629, Blast_Score=82, Evalue=8e-16, Organism=Escherichia coli, GI1787376, Length=435, Percent_Identity=28.0459770114943, Blast_Score=142, Evalue=6e-35, Organism=Caenorhabditis elegans, GI17508577, Length=471, Percent_Identity=24.6284501061571, Blast_Score=87, Evalue=2e-17, Organism=Caenorhabditis elegans, GI32564234, Length=341, Percent_Identity=26.099706744868, Blast_Score=78, Evalue=1e-14, Organism=Caenorhabditis elegans, GI17553882, Length=225, Percent_Identity=28.4444444444444, Blast_Score=67, Evalue=3e-11, Organism=Saccharomyces cerevisiae, GI6323391, Length=475, Percent_Identity=24, Blast_Score=88, Evalue=4e-18, Organism=Drosophila melanogaster, GI24647570, Length=469, Percent_Identity=24.0938166311301, Blast_Score=86, Evalue=4e-17,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR019468 - InterPro: IPR003031 - InterPro: IPR000362 - InterPro: IPR020557 - InterPro: IPR008948 - InterPro: IPR022761 - InterPro: IPR004769 [H]
Pfam domain/function: PF10397 ADSL_C; PF00206 Lyase_1 [H]
EC number: =4.3.2.2 [H]
Molecular weight: Translated: 52894; Mature: 52894
Theoretical pI: Translated: 7.69; Mature: 7.69
Prosite motif: PS00163 FUMARATE_LYASES
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.9 %Cys (Translated Protein) 3.2 %Met (Translated Protein) 4.1 %Cys+Met (Translated Protein) 0.9 %Cys (Mature Protein) 3.2 %Met (Mature Protein) 4.1 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MERNIFENICPLDHRYSLKKDLFNDLGKYFSEKATIYFQARVELALVKALAGRGVCSFDV CCCCHHHHHCCCCHHHHHHHHHHHHHHHHHCCCCEEEEEHHHHHHHHHHHHCCCCCHHHH VKEVEEAVKGIKVGEVYEEEARTRHNIRALVNCIRKKISAEARPFVHLSATSFDIVDTAN HHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCEEEEECCCCHHHHCHH SLRYKEATEKLIVPALERLLEQWLNLAEQERDTLQIGRTHGQHAEPLTFGLVMAYYASRL HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHH HERIVNLEKVVSSLCGKMAGAVGAYNASSLFFEDPEEFEKEVLKELGLKPAPVSTQIVPP HHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCHHHHHHHHHHHCCCCCCCCCCCCCCH EYMTDYVHSLITVFGVLADFSDDMRHLQRTEIGETGEYFAKDQVGSSTMPHKRNPINYEN HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHCCCCCCCCCCCCCCCHHH VKSMWKTFMPRMVTMYLDQLSEHQRDLTNSASGRFIAEIASGLMMTVDRLYKVSSRMKIN HHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHH SRKMKNNFNLSKNMIIAEPLYIFLAAAGHPDAHEYVRKLTLKADKEGKDLVELIKADKEI HHHHHCCCCCCCCEEHHHHHHHHHCCCCCCCHHHHHHHHHHHCCCCCHHHHHHHHHHHHH ETYLAKLDKRQKDILYNPEQYTGIARERTEEIVTKIRKERGL HHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHCCC >Mature Secondary Structure MERNIFENICPLDHRYSLKKDLFNDLGKYFSEKATIYFQARVELALVKALAGRGVCSFDV CCCCHHHHHCCCCHHHHHHHHHHHHHHHHHCCCCEEEEEHHHHHHHHHHHHCCCCCHHHH VKEVEEAVKGIKVGEVYEEEARTRHNIRALVNCIRKKISAEARPFVHLSATSFDIVDTAN HHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCEEEEECCCCHHHHCHH SLRYKEATEKLIVPALERLLEQWLNLAEQERDTLQIGRTHGQHAEPLTFGLVMAYYASRL HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHH HERIVNLEKVVSSLCGKMAGAVGAYNASSLFFEDPEEFEKEVLKELGLKPAPVSTQIVPP HHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCHHHHHHHHHHHCCCCCCCCCCCCCCH EYMTDYVHSLITVFGVLADFSDDMRHLQRTEIGETGEYFAKDQVGSSTMPHKRNPINYEN HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHCCCCCCCCCCCCCCCHHH VKSMWKTFMPRMVTMYLDQLSEHQRDLTNSASGRFIAEIASGLMMTVDRLYKVSSRMKIN HHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHH SRKMKNNFNLSKNMIIAEPLYIFLAAAGHPDAHEYVRKLTLKADKEGKDLVELIKADKEI HHHHHCCCCCCCCEEHHHHHHHHHCCCCCCCHHHHHHHHHHHCCCCCHHHHHHHHHHHHH ETYLAKLDKRQKDILYNPEQYTGIARERTEEIVTKIRKERGL HHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHCCC
PDB accession: NA
Resolution: NA
Structure class: Alpha
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 12622808 [H]