Definition Helicobacter pylori HPAG1 chromosome, complete genome.
Accession NC_008086
Length 1,596,366

Click here to switch to the map view.

The map label for this gene is purA [H]

Identifier: 108562682

GI number: 108562682

Start: 262151

End: 263386

Strand: Direct

Name: purA [H]

Synonym: HPAG1_0257

Alternate gene names: 108562682

Gene position: 262151-263386 (Clockwise)

Preceding gene: 108562681

Following gene: 108562683

Centisome position: 16.42

GC content: 44.5

Gene sequence:

>1236_bases
ATGGCAGATGTCGTTGTGGGGATCCAGTGGGGAGATGAGGGGAAGGGAAAAATTGTTGATAGGATCGCTAAAGATTATGA
CTTTGTGGTGCGTTATCAAGGCGGGCATAATGCTGGGCATACCATTGTGCATAAGGGGGTTAAGCATTCTTTGCATTTAA
TGCCCTCAGGGGTTTTATACCCCAAATGCAAGAACATCATTTCTAGCGCGGTGGTCGTGAGTATTAAGGATTTGTGCGAA
GAAATCAGCGCGTTTGAGGATTTAGAAAATCGTTTGTTTATCAGCGACAGAGCCCATGTGATCTTGCCTTATCATGCCAA
AAAAGACGCTTTTAAAGAAAAATCTCAAAACATCGGCACGACTAAAAAAGGCATAGGTCCTTGCTATGAGGATAAAATGG
CCAGGAGCGGGATAAGAATGGGGGATTTATTAGACGATACCATATTAGAAGAGAAACTAAACGCTCATTTCAAAGCCATT
GAGCCTTTTAAAGAAGCGTATGATTTGGGCGAGGATTACGAAAAGGATTTGAGGGAGTATTTTAAACAATACACCCCAAA
AATCCGCCCCTTTATCAAAGACACGACAAGCATGCTGATAGAAGCGAACCAAAAGGGTGCAAAAATCCTATTAGAAGGGG
CGCAAGGCACGCTTTTAGACATTGATTTAGGGACTTACCCTTTTGTAACAAGCTCCAACACCACGAGCGCTAGCGCATGC
GTGAGCACCGGCTTAAACCCTAAAGCGATCAATGAAGTGATAGGCATCACGAAAGCCTACTCCACTCGTGTGGGTAATGG
GCCTTTCCCTAGCGAAGACGCTACACCCATGGGCGATCATTTAAGGACTAAGGGTGCGGAGTTTGGCACGACAACCAAGC
GCCCAAGGCGTTGCGGGTGGCTGGATTTGGTGGCTTTAAAATACGCTTGCGCTTTGAATGGTTGCACGCAATTAGCTTTA
ATGAAATTAGACGTTTTAGACGGGATTGATGCGATTAAGGTGTGCGTGGCTTATGAAAGAAAGGGCGAAAGATTGGAGGC
TTTCCCTAGCGATTTGAAAGATTGCGTGCCGGTCTATCAAACTTTTAAAGGCTGGGAAAAAAGCGTGGGCGTGAGAAAAT
TAGACGATTTAGAGCCAAACGCTAGAGAGTATATCCGTTTTATTGAAAAAGAAGTGGGGGTAAAAATCCGCCTTATTTCT
ACAAGCCCTGAAAGAGAAGACACGATTTTTCTATGA

Upstream 100 bases:

>100_bases
AAGCTCTTTTTAGGGCTTATAAAGAGACTCTTTACTTTTTTTTGGTATTCTAACAAGCTTTTAAACAATCCAATCTACTT
TGTTTTAAGGATAATATTTT

Downstream 100 bases:

>100_bases
AAAAATTCGCTTCCGTATTGGTGCAATTAAAAACCCTTGCGTTAGAAAAAATAGAGCAAAAGCTTGAAAGCAAGCGTTTA
GAATTGCAACAAAATGAGCG

Product: adenylosuccinate synthetase

Products: NA

Alternate protein names: AMPSase; AdSS; IMP--aspartate ligase [H]

Number of amino acids: Translated: 411; Mature: 410

Protein sequence:

>411_residues
MADVVVGIQWGDEGKGKIVDRIAKDYDFVVRYQGGHNAGHTIVHKGVKHSLHLMPSGVLYPKCKNIISSAVVVSIKDLCE
EISAFEDLENRLFISDRAHVILPYHAKKDAFKEKSQNIGTTKKGIGPCYEDKMARSGIRMGDLLDDTILEEKLNAHFKAI
EPFKEAYDLGEDYEKDLREYFKQYTPKIRPFIKDTTSMLIEANQKGAKILLEGAQGTLLDIDLGTYPFVTSSNTTSASAC
VSTGLNPKAINEVIGITKAYSTRVGNGPFPSEDATPMGDHLRTKGAEFGTTTKRPRRCGWLDLVALKYACALNGCTQLAL
MKLDVLDGIDAIKVCVAYERKGERLEAFPSDLKDCVPVYQTFKGWEKSVGVRKLDDLEPNAREYIRFIEKEVGVKIRLIS
TSPEREDTIFL

Sequences:

>Translated_411_residues
MADVVVGIQWGDEGKGKIVDRIAKDYDFVVRYQGGHNAGHTIVHKGVKHSLHLMPSGVLYPKCKNIISSAVVVSIKDLCE
EISAFEDLENRLFISDRAHVILPYHAKKDAFKEKSQNIGTTKKGIGPCYEDKMARSGIRMGDLLDDTILEEKLNAHFKAI
EPFKEAYDLGEDYEKDLREYFKQYTPKIRPFIKDTTSMLIEANQKGAKILLEGAQGTLLDIDLGTYPFVTSSNTTSASAC
VSTGLNPKAINEVIGITKAYSTRVGNGPFPSEDATPMGDHLRTKGAEFGTTTKRPRRCGWLDLVALKYACALNGCTQLAL
MKLDVLDGIDAIKVCVAYERKGERLEAFPSDLKDCVPVYQTFKGWEKSVGVRKLDDLEPNAREYIRFIEKEVGVKIRLIS
TSPEREDTIFL
>Mature_410_residues
ADVVVGIQWGDEGKGKIVDRIAKDYDFVVRYQGGHNAGHTIVHKGVKHSLHLMPSGVLYPKCKNIISSAVVVSIKDLCEE
ISAFEDLENRLFISDRAHVILPYHAKKDAFKEKSQNIGTTKKGIGPCYEDKMARSGIRMGDLLDDTILEEKLNAHFKAIE
PFKEAYDLGEDYEKDLREYFKQYTPKIRPFIKDTTSMLIEANQKGAKILLEGAQGTLLDIDLGTYPFVTSSNTTSASACV
STGLNPKAINEVIGITKAYSTRVGNGPFPSEDATPMGDHLRTKGAEFGTTTKRPRRCGWLDLVALKYACALNGCTQLALM
KLDVLDGIDAIKVCVAYERKGERLEAFPSDLKDCVPVYQTFKGWEKSVGVRKLDDLEPNAREYIRFIEKEVGVKIRLIST
SPEREDTIFL

Specific function: Plays an important role in the de novo pathway of purine nucleotide biosynthesis. Catalyzes the first commited step in the biosynthesis of AMP from IMP [H]

COG id: COG0104

COG function: function code F; Adenylosuccinate synthase

Gene ontology:

Cell location: Cytoplasm [H]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the adenylosuccinate synthetase family [H]

Homologues:

Organism=Homo sapiens, GI22748717, Length=426, Percent_Identity=44.131455399061, Blast_Score=353, Evalue=2e-97,
Organism=Homo sapiens, GI34577063, Length=428, Percent_Identity=45.3271028037383, Blast_Score=351, Evalue=6e-97,
Organism=Homo sapiens, GI40316944, Length=397, Percent_Identity=42.5692695214106, Blast_Score=312, Evalue=4e-85,
Organism=Escherichia coli, GI1790620, Length=426, Percent_Identity=45.7746478873239, Blast_Score=345, Evalue=2e-96,
Organism=Caenorhabditis elegans, GI25146553, Length=423, Percent_Identity=41.8439716312057, Blast_Score=328, Evalue=5e-90,
Organism=Caenorhabditis elegans, GI25146555, Length=423, Percent_Identity=41.8439716312057, Blast_Score=327, Evalue=5e-90,
Organism=Saccharomyces cerevisiae, GI6324109, Length=429, Percent_Identity=42.6573426573427, Blast_Score=358, Evalue=1e-99,
Organism=Drosophila melanogaster, GI21356033, Length=424, Percent_Identity=45.9905660377358, Blast_Score=366, Evalue=1e-101,

Paralogues:

None

Copy number: 940 Molecules/Cell In: Growth Phase, Minimal Media (Based on E. coli). [C]

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR018220
- InterPro:   IPR001114 [H]

Pfam domain/function: PF00709 Adenylsucc_synt [H]

EC number: =6.3.4.4 [H]

Molecular weight: Translated: 45781; Mature: 45650

Theoretical pI: Translated: 7.21; Mature: 7.21

Prosite motif: PS01266 ADENYLOSUCCIN_SYN_1 ; PS00513 ADENYLOSUCCIN_SYN_2

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

2.2 %Cys     (Translated Protein)
1.7 %Met     (Translated Protein)
3.9 %Cys+Met (Translated Protein)
2.2 %Cys     (Mature Protein)
1.5 %Met     (Mature Protein)
3.7 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MADVVVGIQWGDEGKGKIVDRIAKDYDFVVRYQGGHNAGHTIVHKGVKHSLHLMPSGVLY
CCCEEEEEEECCCCCCHHHHHHHCCCEEEEEECCCCCCCHHHHHHHHHHHHHCCCCCCCC
PKCKNIISSAVVVSIKDLCEEISAFEDLENRLFISDRAHVILPYHAKKDAFKEKSQNIGT
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCEEEECCCEEEEEECCCHHHHHHHHCCCCC
TKKGIGPCYEDKMARSGIRMGDLLDDTILEEKLNAHFKAIEPFKEAYDLGEDYEKDLREY
CCCCCCCCHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHH
FKQYTPKIRPFIKDTTSMLIEANQKGAKILLEGAQGTLLDIDLGTYPFVTSSNTTSASAC
HHHHCCCHHHHHHHHHHHHHHCCCCCCEEEEECCCCCEEEEECCCCCEEECCCCCCHHHH
VSTGLNPKAINEVIGITKAYSTRVGNGPFPSEDATPMGDHLRTKGAEFGTTTKRPRRCGW
HHCCCCHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCHHHHHCCCCCCCCCCCCCCCCH
LDLVALKYACALNGCTQLALMKLDVLDGIDAIKVCVAYERKGERLEAFPSDLKDCVPVYQ
HHHHHHHHHHHHCCHHHHHHHHHHHHCCHHHHHHHHHHHHCCCHHHHCHHHHHHHHHHHH
TFKGWEKSVGVRKLDDLEPNAREYIRFIEKEVGVKIRLISTSPEREDTIFL
HHHHHHHCCCCCCCCCCCCCHHHHHHHHHHHHCEEEEEEECCCCCCCCCCC
>Mature Secondary Structure 
ADVVVGIQWGDEGKGKIVDRIAKDYDFVVRYQGGHNAGHTIVHKGVKHSLHLMPSGVLY
CCEEEEEEECCCCCCHHHHHHHCCCEEEEEECCCCCCCHHHHHHHHHHHHHCCCCCCCC
PKCKNIISSAVVVSIKDLCEEISAFEDLENRLFISDRAHVILPYHAKKDAFKEKSQNIGT
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCEEEECCCEEEEEECCCHHHHHHHHCCCCC
TKKGIGPCYEDKMARSGIRMGDLLDDTILEEKLNAHFKAIEPFKEAYDLGEDYEKDLREY
CCCCCCCCHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHH
FKQYTPKIRPFIKDTTSMLIEANQKGAKILLEGAQGTLLDIDLGTYPFVTSSNTTSASAC
HHHHCCCHHHHHHHHHHHHHHCCCCCCEEEEECCCCCEEEEECCCCCEEECCCCCCHHHH
VSTGLNPKAINEVIGITKAYSTRVGNGPFPSEDATPMGDHLRTKGAEFGTTTKRPRRCGW
HHCCCCHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCHHHHHCCCCCCCCCCCCCCCCH
LDLVALKYACALNGCTQLALMKLDVLDGIDAIKVCVAYERKGERLEAFPSDLKDCVPVYQ
HHHHHHHHHHHHCCHHHHHHHHHHHHCCHHHHHHHHHHHHCCCHHHHCHHHHHHHHHHHH
TFKGWEKSVGVRKLDDLEPNAREYIRFIEKEVGVKIRLISTSPEREDTIFL
HHHHHHHCCCCCCCCCCCCCHHHHHHHHHHHHCEEEEEEECCCCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA