Definition Chlamydia muridarum Nigg, complete genome.
Accession NC_002620
Length 1,072,950

Click here to switch to the map view.

The map label for this gene is aroDE

Identifier: 15835264

GI number: 15835264

Start: 775938

End: 777374

Strand: Direct

Name: aroDE

Synonym: TC0649

Alternate gene names: 15835264

Gene position: 775938-777374 (Clockwise)

Preceding gene: 15835263

Following gene: 15835265

Centisome position: 72.32

GC content: 43.08

Gene sequence:

>1437_bases
ATGCTATGCACGATCATTAGAGGCCCTTCTTTCCTTGAAGCCAGAAATCAGCTATTGCGCTCTTTAAAAAAATGCCGTTG
CTTTGAAATGCGTGCAGATCTTCTTACTGTATCCGATGCAGAACTACAAAAACTGATTCTCCTAGCTCCTATTTCTGTCC
TTACATGGAAAAAACCCCCATCCTGTACGCCACAAGCCTGGGTAAAAAAAATACAATCACTAGCTAAGCTTCATCCAACC
TATTTGGATTTAGATAAAGATTTCCCAGAAGAAGAGATTCTGCACATTCGTCATCTTCATCCTAATATTAAGATCATACG
CTCCTTACACACCAGCGAGCATACCGACATTACACAACTATATACACAGATGCTGGCTTCATCTATCGATTACTATAAAC
TTGCTGTTTCCCCTGCTTCTACTACAGATCTCCTGAATATCTGCCGTCAAAAGCACTCTCTCCCTCAGAATACAACTGTG
CTCTGCTTGGGGAAAATCGGCCAGTCTTCGCGTATACTCTCTCCTATTTTACAAAATCCCTTTACCTACACAATCCCTAC
AGGGGCTGATCCTGTAGCCCCAGGGCAACTCTCCCTTAACCATCACTACTTTTACAATTTCACAAACCTTTCTCCCCAAT
CCCAGATCTGCGCTCTCATTGGAGACACTTCAAGAAGCATAGGACACCTCACTCATAATCCTTTCTTCTCTCAGCTGAGC
ATTCCCTGCCCCTATGTTAAGCTTCCTCTAACCCCACAAGAACTTCCCGAATTTTTCTCCTCTATTCGAGCTCTTCCCTT
TCTAGGAATAAGCGTAACCTCCCCTCTCAAAACTGCTATCATCCCGTTTCTTGACAAACAAGATTCCTCTGTAAAACTCT
CTGGATCTTGTAATACACTTGTTATTCGACAAGGAGAAATTATAGGCTATGATACTGACGGAGAAGGTCTTTTTTCAGTC
CTGACTCAACACAACATGGATTTAAGCAACCAACGCGTTGCTATCTTAGGAGCCGGAGGAGCAGCACGATCCATCGCAGC
ACGATTGAGTAGAACCGGATGCGAGCTTCTCATTTTTAATCGAACCAAAATCCATGCCGAAGCTATTGCTTCTCGTTACC
AAGCGCAAGCTTTTGATATAAAAGATCTTCCGCTACATTCTGTTTCTCTTATCATCAACTGCCTTCCCCCTTCCTCTATC
ATTCCTCAAGCTCTAGCTCCTCTTATCGTAGACATCAATACCCTTCCTAAACACAACTCGTTTACTCAGTATGCTCGGTT
GAAAGGATGTTCCATCATCTATGGCCATGAAATGTTCGCGCAACAAGCGCTTTTACAATTCCGCTTATGGTTTCCAACAC
ACTCTTTTAACCATCTAGAAAAAAACTTTTCTCGTAGAGCCGCTGTTCTAGCCTCTCTTTTTTCCATCGCAGCATAA

Upstream 100 bases:

>100_bases
GTTATGATAGAAGAGATCGGACTCGCAGCCTCTTGTAATGGTAGTTTCTGCCAACCTGCATCTAATCATTTTCTTACACA
CATTTTAAAGGAAGATCTCC

Downstream 100 bases:

>100_bases
AAAATTTTTTTCTATTCTACTCCTGCGTTTTTAGGAGGCTGTATGCGATTTTTATTTGCCTTTATTCTTCTATGCTCCCC
CTGGGTCTCTGAAGCATCGC

Product: bifunctional 3-dehydroquinate dehydratase/shikimate dehydrogenase protein

Products: NA

Alternate protein names: 3-dehydroquinate dehydratase; 3-dehydroquinase; Type I DHQase; Shikimate dehydrogenase

Number of amino acids: Translated: 478; Mature: 478

Protein sequence:

>478_residues
MLCTIIRGPSFLEARNQLLRSLKKCRCFEMRADLLTVSDAELQKLILLAPISVLTWKKPPSCTPQAWVKKIQSLAKLHPT
YLDLDKDFPEEEILHIRHLHPNIKIIRSLHTSEHTDITQLYTQMLASSIDYYKLAVSPASTTDLLNICRQKHSLPQNTTV
LCLGKIGQSSRILSPILQNPFTYTIPTGADPVAPGQLSLNHHYFYNFTNLSPQSQICALIGDTSRSIGHLTHNPFFSQLS
IPCPYVKLPLTPQELPEFFSSIRALPFLGISVTSPLKTAIIPFLDKQDSSVKLSGSCNTLVIRQGEIIGYDTDGEGLFSV
LTQHNMDLSNQRVAILGAGGAARSIAARLSRTGCELLIFNRTKIHAEAIASRYQAQAFDIKDLPLHSVSLIINCLPPSSI
IPQALAPLIVDINTLPKHNSFTQYARLKGCSIIYGHEMFAQQALLQFRLWFPTHSFNHLEKNFSRRAAVLASLFSIAA

Sequences:

>Translated_478_residues
MLCTIIRGPSFLEARNQLLRSLKKCRCFEMRADLLTVSDAELQKLILLAPISVLTWKKPPSCTPQAWVKKIQSLAKLHPT
YLDLDKDFPEEEILHIRHLHPNIKIIRSLHTSEHTDITQLYTQMLASSIDYYKLAVSPASTTDLLNICRQKHSLPQNTTV
LCLGKIGQSSRILSPILQNPFTYTIPTGADPVAPGQLSLNHHYFYNFTNLSPQSQICALIGDTSRSIGHLTHNPFFSQLS
IPCPYVKLPLTPQELPEFFSSIRALPFLGISVTSPLKTAIIPFLDKQDSSVKLSGSCNTLVIRQGEIIGYDTDGEGLFSV
LTQHNMDLSNQRVAILGAGGAARSIAARLSRTGCELLIFNRTKIHAEAIASRYQAQAFDIKDLPLHSVSLIINCLPPSSI
IPQALAPLIVDINTLPKHNSFTQYARLKGCSIIYGHEMFAQQALLQFRLWFPTHSFNHLEKNFSRRAAVLASLFSIAA
>Mature_478_residues
MLCTIIRGPSFLEARNQLLRSLKKCRCFEMRADLLTVSDAELQKLILLAPISVLTWKKPPSCTPQAWVKKIQSLAKLHPT
YLDLDKDFPEEEILHIRHLHPNIKIIRSLHTSEHTDITQLYTQMLASSIDYYKLAVSPASTTDLLNICRQKHSLPQNTTV
LCLGKIGQSSRILSPILQNPFTYTIPTGADPVAPGQLSLNHHYFYNFTNLSPQSQICALIGDTSRSIGHLTHNPFFSQLS
IPCPYVKLPLTPQELPEFFSSIRALPFLGISVTSPLKTAIIPFLDKQDSSVKLSGSCNTLVIRQGEIIGYDTDGEGLFSV
LTQHNMDLSNQRVAILGAGGAARSIAARLSRTGCELLIFNRTKIHAEAIASRYQAQAFDIKDLPLHSVSLIINCLPPSSI
IPQALAPLIVDINTLPKHNSFTQYARLKGCSIIYGHEMFAQQALLQFRLWFPTHSFNHLEKNFSRRAAVLASLFSIAA

Specific function: Bifunctional enzyme that catalyzes two sequential steps of the aromatic amino acids biosynthetic pathway. The first reaction is catalyzed by the 3-dehydroquinate dehydratase, coded by the AroD domain; the second reaction is catalyzed by the shikimate 5-de

COG id: COG0169

COG function: function code E; Shikimate 5-dehydrogenase

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: In the C-terminal section; belongs to the shikimate dehydrogenase family

Homologues:

Organism=Escherichia coli, GI1787983, Length=246, Percent_Identity=26.4227642276423, Blast_Score=83, Evalue=4e-17,
Organism=Escherichia coli, GI1789675, Length=171, Percent_Identity=32.1637426900585, Blast_Score=75, Evalue=1e-14,
Organism=Saccharomyces cerevisiae, GI6320332, Length=413, Percent_Identity=22.0338983050847, Blast_Score=68, Evalue=3e-12,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): ARODE_CHLMU (P56961)

Other databases:

- EMBL:   AE002160
- PIR:   G81679
- RefSeq:   NP_297023.1
- ProteinModelPortal:   P56961
- SMR:   P56961
- GeneID:   1246010
- GenomeReviews:   AE002160_GR
- KEGG:   cmu:TC0649
- TIGR:   TC_0649
- HOGENOM:   HBG414053
- OMA:   ISHLSHN
- ProtClustDB:   PRK09310
- BioCyc:   CMUR243161:TC_0649-MONOMER
- BRENDA:   1.1.1.25
- BRENDA:   4.2.1.10
- GO:   GO:0005737
- HAMAP:   MF_00214
- HAMAP:   MF_00222
- InterPro:   IPR013785
- InterPro:   IPR001381
- InterPro:   IPR016040
- InterPro:   IPR011342
- InterPro:   IPR013708
- InterPro:   IPR006151
- Gene3D:   G3DSA:3.20.20.70
- Gene3D:   G3DSA:3.40.50.720
- TIGRFAMs:   TIGR00507

Pfam domain/function: PF01487 DHquinase_I; PF01488 Shikimate_DH; PF08501 Shikimate_dh_N

EC number: =4.2.1.10; =1.1.1.25

Molecular weight: Translated: 53211; Mature: 53211

Theoretical pI: Translated: 9.00; Mature: 9.00

Prosite motif: PS01028 DEHYDROQUINASE_I

Important sites: ACT_SITE 110-110 ACT_SITE 133-133

Signals:

None

Transmembrane regions:

None

Cys/Met content:

2.5 %Cys     (Translated Protein)
1.0 %Met     (Translated Protein)
3.6 %Cys+Met (Translated Protein)
2.5 %Cys     (Mature Protein)
1.0 %Met     (Mature Protein)
3.6 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MLCTIIRGPSFLEARNQLLRSLKKCRCFEMRADLLTVSDAELQKLILLAPISVLTWKKPP
CEEEEECCCHHHHHHHHHHHHHHHHHHHHHHHCEEEECHHHHHHHHHHCCHHHEECCCCC
SCTPQAWVKKIQSLAKLHPTYLDLDKDFPEEEILHIRHLHPNIKIIRSLHTSEHTDITQL
CCCHHHHHHHHHHHHHHCCCEEECCCCCCHHHHHHHHHCCCCHHHHHHHHCCCCCHHHHH
YTQMLASSIDYYKLAVSPASTTDLLNICRQKHSLPQNTTVLCLGKIGQSSRILSPILQNP
HHHHHHCCCCEEEEEECCCCHHHHHHHHHHHHCCCCCCEEEEEECCCCCHHHHHHHHCCC
FTYTIPTGADPVAPGQLSLNHHYFYNFTNLSPQSQICALIGDTSRSIGHLTHNPFFSQLS
EEEECCCCCCCCCCCEEEECEEEEEEECCCCCHHHHEEEECCCCCCCCCCCCCCCHHHCC
IPCPYVKLPLTPQELPEFFSSIRALPFLGISVTSPLKTAIIPFLDKQDSSVKLSGSCNTL
CCCCEEECCCCHHHHHHHHHHHHHCCEECCCCCCCHHHHHHHCCCCCCCCEEECCCCCEE
VIRQGEIIGYDTDGEGLFSVLTQHNMDLSNQRVAILGAGGAARSIAARLSRTGCELLIFN
EEECCCEEEECCCCHHHHHHHHHCCCCCCCCEEEEEECCCHHHHHHHHHHHCCCEEEEEE
RTKIHAEAIASRYQAQAFDIKDLPLHSVSLIINCLPPSSIIPQALAPLIVDINTLPKHNS
CCHHHHHHHHHHHHHHHCCCCCCCCCEEEEEEECCCCCHHHHHHHHHHEEECCCCCCCCC
FTQYARLKGCSIIYGHEMFAQQALLQFRLWFPTHSFNHLEKNFSRRAAVLASLFSIAA
HHHHHHHCCCEEEECHHHHHHHHHHHEEEECCCCCHHHHHHHHHHHHHHHHHHHHHCC
>Mature Secondary Structure
MLCTIIRGPSFLEARNQLLRSLKKCRCFEMRADLLTVSDAELQKLILLAPISVLTWKKPP
CEEEEECCCHHHHHHHHHHHHHHHHHHHHHHHCEEEECHHHHHHHHHHCCHHHEECCCCC
SCTPQAWVKKIQSLAKLHPTYLDLDKDFPEEEILHIRHLHPNIKIIRSLHTSEHTDITQL
CCCHHHHHHHHHHHHHHCCCEEECCCCCCHHHHHHHHHCCCCHHHHHHHHCCCCCHHHHH
YTQMLASSIDYYKLAVSPASTTDLLNICRQKHSLPQNTTVLCLGKIGQSSRILSPILQNP
HHHHHHCCCCEEEEEECCCCHHHHHHHHHHHHCCCCCCEEEEEECCCCCHHHHHHHHCCC
FTYTIPTGADPVAPGQLSLNHHYFYNFTNLSPQSQICALIGDTSRSIGHLTHNPFFSQLS
EEEECCCCCCCCCCCEEEECEEEEEEECCCCCHHHHEEEECCCCCCCCCCCCCCCHHHCC
IPCPYVKLPLTPQELPEFFSSIRALPFLGISVTSPLKTAIIPFLDKQDSSVKLSGSCNTL
CCCCEEECCCCHHHHHHHHHHHHHCCEECCCCCCCHHHHHHHCCCCCCCCEEECCCCCEE
VIRQGEIIGYDTDGEGLFSVLTQHNMDLSNQRVAILGAGGAARSIAARLSRTGCELLIFN
EEECCCEEEECCCCHHHHHHHHHCCCCCCCCEEEEEECCCHHHHHHHHHHHCCCEEEEEE
RTKIHAEAIASRYQAQAFDIKDLPLHSVSLIINCLPPSSIIPQALAPLIVDINTLPKHNS
CCHHHHHHHHHHHHHHHCCCCCCCCCEEEEEEECCCCCHHHHHHHHHHEEECCCCCCCCC
FTQYARLKGCSIIYGHEMFAQQALLQFRLWFPTHSFNHLEKNFSRRAAVLASLFSIAA
HHHHHHHCCCEEEECHHHHHHHHHHHEEEECCCCCHHHHHHHHHHHHHHHHHHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 10684935