Definition Novosphingobium aromaticivorans DSM 12444 chromosome, complete genome.
Accession NC_007794
Length 3,561,584

Click here to switch to the map view.

The map label for this gene is purA

Identifier: 87200696

GI number: 87200696

Start: 2922561

End: 2923850

Strand: Direct

Name: purA

Synonym: Saro_2683

Alternate gene names: 87200696

Gene position: 2922561-2923850 (Clockwise)

Preceding gene: 87200694

Following gene: 87200697

Centisome position: 82.06

GC content: 67.6

Gene sequence:

>1290_bases
ATGGCCAATGTAACCGTGATTGGTGCCCAGTGGGGCGATGAAGGCAAGGGCAAGATCGTGGACTGGCTCGCCAGCCGCGC
CGATGCCGTCGTCCGTTTCCAGGGCGGCCACAATGCCGGCCACACCCTCGTCGTGGGCGAACAGGTCTACAAGCTCTCGC
TGCTGCCTTCGGGCATCGTCACCGGCACGCTGTCGATCATCGGCAACGGCGTCGTGCTCGATCCCTGGGCCTTGAAGGCA
GAGATCGAGAAGCTGACCGGCCAGGGCGTCGAGATCAATGCCGAGAACTTCGCCATTGCCGACAATTGCCCGCTGATTCT
CCCGCTCCACCGCGATCTCGACGGCCTGCGCGAACAGGCCGCCGGCGCCGGCAAGATCGGCACCACCGGTCGGGGCATCG
GCCCGGCCTATGAAGACAAGGTCGGCCGCCGCGCGATCCGCGTCTGCGACCTCGCTCATCTCGATGCGCTCGATGCGCAG
CTCGACCGCCTTTGCGCCCACCACGATGCACTGCGCGCCGGCTTCGGCCAGCCGCCGGTGGACCGCGCCGCCCTGATCGA
GGAACTGCGTGAAATCGCGCCATACGTGCTGCAGTTCGCCCAGCCCGTGTGGAAGCGCCTCAATACCGTCCGCAAGGCCG
GCGCGCGCATCCTGTTCGAAGGCGCCCAGGGCGTGCTGCTCGACGTCGATCACGGCACCTATCCGTTCGTCACCTCGTCG
AACACCGTTTCCGGCACCGCCGCTTCGGGTTCGGGCCTCGGCCCCGCGCAGACCGGCTTCGTGCTGGGCATCGTCAAGGC
CTACACCACCCGCGTCGGCTCCGGTCCCTTCCCGACCGAGCTCGAGGACGAGACCGGCCAGCGCCTTGGCGAACGCGGCC
ACGAATTCGGCACGGTCACGGGCCGCAAGCGCCGCTGCGGCTGGTTCGACGCCGTGCTGGTGCGCCAGTCCTGCGCGATC
TCCGGCGTGACCGGCATCGCGCTGACCAAGCTCGACGTGCTCGACGGCTTTGAAAAGGTGAAGATCTGCACCGGCTACCG
CCTGCGCGGCAAGGTGCTGGACTACTTCCCCAGCCACGCGGCCGACCAGGCCGAAGTCGAGCCGATCTACGAGGAAATGG
ACGGCTGGAGCGGCACCACCGCCGGTGCCCGCTCATGGGCCGATCTGCCTGCCCAGGCGATCAAGTACATCCAGCGCGTG
CAGGAACTGATCGAAACGCCGGTCGCGCTGGTCTCCACCAGCCCGGAACGCGAGGACACGATCCTCGTCCGCGATCCCTT
CGTCGACTGA

Upstream 100 bases:

>100_bases
TCGAAAAACCGGGGCCGTGCCCCGCCCATCCATCCCGTTTCGCCGAGTCCTGTCGAAGGGCGTCTTGAGGATCCACCTGG
CAGGGTGGAGGAGTGTATTC

Downstream 100 bases:

>100_bases
TCGTCCCGCGCCCTCTCCCTTCGGGGAGAGGGTTGGTTAGCAACGCTGGTTGAGCTAGCCTCGCCCGGCCATGGCCGACC
TGCGCATACTGCTGCTGCTG

Product: adenylosuccinate synthetase

Products: NA

Alternate protein names: AMPSase; AdSS; IMP--aspartate ligase

Number of amino acids: Translated: 429; Mature: 428

Protein sequence:

>429_residues
MANVTVIGAQWGDEGKGKIVDWLASRADAVVRFQGGHNAGHTLVVGEQVYKLSLLPSGIVTGTLSIIGNGVVLDPWALKA
EIEKLTGQGVEINAENFAIADNCPLILPLHRDLDGLREQAAGAGKIGTTGRGIGPAYEDKVGRRAIRVCDLAHLDALDAQ
LDRLCAHHDALRAGFGQPPVDRAALIEELREIAPYVLQFAQPVWKRLNTVRKAGARILFEGAQGVLLDVDHGTYPFVTSS
NTVSGTAASGSGLGPAQTGFVLGIVKAYTTRVGSGPFPTELEDETGQRLGERGHEFGTVTGRKRRCGWFDAVLVRQSCAI
SGVTGIALTKLDVLDGFEKVKICTGYRLRGKVLDYFPSHAADQAEVEPIYEEMDGWSGTTAGARSWADLPAQAIKYIQRV
QELIETPVALVSTSPEREDTILVRDPFVD

Sequences:

>Translated_429_residues
MANVTVIGAQWGDEGKGKIVDWLASRADAVVRFQGGHNAGHTLVVGEQVYKLSLLPSGIVTGTLSIIGNGVVLDPWALKA
EIEKLTGQGVEINAENFAIADNCPLILPLHRDLDGLREQAAGAGKIGTTGRGIGPAYEDKVGRRAIRVCDLAHLDALDAQ
LDRLCAHHDALRAGFGQPPVDRAALIEELREIAPYVLQFAQPVWKRLNTVRKAGARILFEGAQGVLLDVDHGTYPFVTSS
NTVSGTAASGSGLGPAQTGFVLGIVKAYTTRVGSGPFPTELEDETGQRLGERGHEFGTVTGRKRRCGWFDAVLVRQSCAI
SGVTGIALTKLDVLDGFEKVKICTGYRLRGKVLDYFPSHAADQAEVEPIYEEMDGWSGTTAGARSWADLPAQAIKYIQRV
QELIETPVALVSTSPEREDTILVRDPFVD
>Mature_428_residues
ANVTVIGAQWGDEGKGKIVDWLASRADAVVRFQGGHNAGHTLVVGEQVYKLSLLPSGIVTGTLSIIGNGVVLDPWALKAE
IEKLTGQGVEINAENFAIADNCPLILPLHRDLDGLREQAAGAGKIGTTGRGIGPAYEDKVGRRAIRVCDLAHLDALDAQL
DRLCAHHDALRAGFGQPPVDRAALIEELREIAPYVLQFAQPVWKRLNTVRKAGARILFEGAQGVLLDVDHGTYPFVTSSN
TVSGTAASGSGLGPAQTGFVLGIVKAYTTRVGSGPFPTELEDETGQRLGERGHEFGTVTGRKRRCGWFDAVLVRQSCAIS
GVTGIALTKLDVLDGFEKVKICTGYRLRGKVLDYFPSHAADQAEVEPIYEEMDGWSGTTAGARSWADLPAQAIKYIQRVQ
ELIETPVALVSTSPEREDTILVRDPFVD

Specific function: Plays an important role in the de novo pathway of purine nucleotide biosynthesis. Catalyzes the first commited step in the biosynthesis of AMP from IMP

COG id: COG0104

COG function: function code F; Adenylosuccinate synthase

Gene ontology:

Cell location: Cytoplasm

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the adenylosuccinate synthetase family

Homologues:

Organism=Homo sapiens, GI22748717, Length=422, Percent_Identity=43.6018957345972, Blast_Score=331, Evalue=8e-91,
Organism=Homo sapiens, GI34577063, Length=427, Percent_Identity=41.2177985948478, Blast_Score=313, Evalue=1e-85,
Organism=Homo sapiens, GI40316944, Length=394, Percent_Identity=41.6243654822335, Blast_Score=290, Evalue=3e-78,
Organism=Escherichia coli, GI1790620, Length=428, Percent_Identity=50.4672897196262, Blast_Score=423, Evalue=1e-119,
Organism=Caenorhabditis elegans, GI25146553, Length=430, Percent_Identity=41.6279069767442, Blast_Score=325, Evalue=2e-89,
Organism=Caenorhabditis elegans, GI25146555, Length=430, Percent_Identity=41.6279069767442, Blast_Score=325, Evalue=3e-89,
Organism=Saccharomyces cerevisiae, GI6324109, Length=432, Percent_Identity=39.3518518518519, Blast_Score=301, Evalue=1e-82,
Organism=Drosophila melanogaster, GI21356033, Length=422, Percent_Identity=40.7582938388626, Blast_Score=308, Evalue=6e-84,

Paralogues:

None

Copy number: 940 Molecules/Cell In: Growth Phase, Minimal Media (Based on E. coli). [C]

Swissprot (AC and ID): PURA_NOVAD (Q2G4V4)

Other databases:

- EMBL:   CP000248
- RefSeq:   YP_497953.1
- ProteinModelPortal:   Q2G4V4
- SMR:   Q2G4V4
- STRING:   Q2G4V4
- GeneID:   3918457
- GenomeReviews:   CP000248_GR
- KEGG:   nar:Saro_2683
- NMPDR:   fig|48935.1.peg.761
- eggNOG:   COG0104
- HOGENOM:   HBG658237
- OMA:   DYVVRYQ
- PhylomeDB:   Q2G4V4
- ProtClustDB:   PRK01117
- BioCyc:   NARO279238:SARO_2683-MONOMER
- GO:   GO:0005737
- HAMAP:   MF_00011
- InterPro:   IPR018220
- InterPro:   IPR001114
- PANTHER:   PTHR11846
- SMART:   SM00788
- TIGRFAMs:   TIGR00184

Pfam domain/function: PF00709 Adenylsucc_synt

EC number: =6.3.4.4

Molecular weight: Translated: 46028; Mature: 45897

Theoretical pI: Translated: 5.66; Mature: 5.66

Prosite motif: PS01266 ADENYLOSUCCIN_SYN_1; PS00513 ADENYLOSUCCIN_SYN_2

Important sites: ACT_SITE 13-13 ACT_SITE 41-41 BINDING 129-129 BINDING 143-143 BINDING 223-223 BINDING 238-238 BINDING 302-302 BINDING 304-304

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.4 %Cys     (Translated Protein)
0.5 %Met     (Translated Protein)
1.9 %Cys+Met (Translated Protein)
1.4 %Cys     (Mature Protein)
0.2 %Met     (Mature Protein)
1.6 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MANVTVIGAQWGDEGKGKIVDWLASRADAVVRFQGGHNAGHTLVVGEQVYKLSLLPSGIV
CCCEEEEECCCCCCCCCHHHHHHHHCCCEEEEEECCCCCCCEEEECCCEEEEECCCCCHH
TGTLSIIGNGVVLDPWALKAEIEKLTGQGVEINAENFAIADNCPLILPLHRDLDGLREQA
HHHHHHHCCCEEECCHHHHHHHHHHCCCCEEECCCCEEEECCCCEEEECCCCHHHHHHHH
AGAGKIGTTGRGIGPAYEDKVGRRAIRVCDLAHLDALDAQLDRLCAHHDALRAGFGQPPV
CCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCC
DRAALIEELREIAPYVLQFAQPVWKRLNTVRKAGARILFEGAQGVLLDVDHGTYPFVTSS
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCEEEEECCCEEEEECCCCCCCEEECC
NTVSGTAASGSGLGPAQTGFVLGIVKAYTTRVGSGPFPTELEDETGQRLGERGHEFGTVT
CCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHCCCCCCCCC
GRKRRCGWFDAVLVRQSCAISGVTGIALTKLDVLDGFEKVKICTGYRLRGKVLDYFPSHA
CCCCCCCHHHHHHHHHHHHHCCCCHHHHHHHHHHCCHHHEEEECCCEECCHHHHHCCCCC
ADQAEVEPIYEEMDGWSGTTAGARSWADLPAQAIKYIQRVQELIETPVALVSTSPEREDT
CCCCHHHHHHHHHCCCCCCCCCCCHHHCCHHHHHHHHHHHHHHHHCCCEEECCCCCCCCE
ILVRDPFVD
EEEECCCCC
>Mature Secondary Structure 
ANVTVIGAQWGDEGKGKIVDWLASRADAVVRFQGGHNAGHTLVVGEQVYKLSLLPSGIV
CCEEEEECCCCCCCCCHHHHHHHHCCCEEEEEECCCCCCCEEEECCCEEEEECCCCCHH
TGTLSIIGNGVVLDPWALKAEIEKLTGQGVEINAENFAIADNCPLILPLHRDLDGLREQA
HHHHHHHCCCEEECCHHHHHHHHHHCCCCEEECCCCEEEECCCCEEEECCCCHHHHHHHH
AGAGKIGTTGRGIGPAYEDKVGRRAIRVCDLAHLDALDAQLDRLCAHHDALRAGFGQPPV
CCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCC
DRAALIEELREIAPYVLQFAQPVWKRLNTVRKAGARILFEGAQGVLLDVDHGTYPFVTSS
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCEEEEECCCEEEEECCCCCCCEEECC
NTVSGTAASGSGLGPAQTGFVLGIVKAYTTRVGSGPFPTELEDETGQRLGERGHEFGTVT
CCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHCCCCCCCCC
GRKRRCGWFDAVLVRQSCAISGVTGIALTKLDVLDGFEKVKICTGYRLRGKVLDYFPSHA
CCCCCCCHHHHHHHHHHHHHCCCCHHHHHHHHHHCCHHHEEEECCCEECCHHHHHCCCCC
ADQAEVEPIYEEMDGWSGTTAGARSWADLPAQAIKYIQRVQELIETPVALVSTSPEREDT
CCCCHHHHHHHHHCCCCCCCCCCCHHHCCHHHHHHHHHHHHHHHHCCCEEECCCCCCCCE
ILVRDPFVD
EEEECCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA