The gene/protein map for NC_008702 is currently unavailable.
Definition Azoarcus sp. BH72 chromosome, complete genome.
Accession NC_008702
Length 4,376,040

Click here to switch to the map view.

The map label for this gene is aroC

Identifier: 119897327

GI number: 119897327

Start: 1113825

End: 1114961

Strand: Direct

Name: aroC

Synonym: azo1036

Alternate gene names: 119897327

Gene position: 1113825-1114961 (Clockwise)

Preceding gene: 119897326

Following gene: 119897328

Centisome position: 25.45

GC content: 68.6

Gene sequence:

>1137_bases
ATGTCCGGCAACACCCTCGGCACGCTGTTCTGCGTCACCTCCTTCGGCGAATCCCACGGCCCCGCGATCGGTTGCGTGAT
CGACGGCTGTCCGCCGGGGCTGAGCCTGACGGCTGCCGATATCCAGGGCGAACTCGATCGCCGCAAGCCCGGCACTTCGC
GTCACGTCACCCAGCGCCGGGAGCCCGACGAGGTCGAGATCCTGTCGGGCGTGTTCGAAGGCGTGACCACCGGAACCCCG
ATCGCCCTGCTGATCCGCAACCAGGACCAGCGTTCCAAGGACTACGGCAACATCGCCGAGACCTTCCGCCCGGGGCACGC
CGACTACCCCTACTGGCAGAAGTACGGCATTCGCGACTATCGCGGCGGCGGCCGGTCGTCGGCGCGCGAGACCGCCGTTC
GCGTGGCCGCGGGCGCGGTGGCGCGCAAGTGGTTGAGCGAGCGCTACGGCATCGTCATCCGCGGCTACATGGCGCAGCTC
GGCCCGCTGCCCATTCCCTTCGTGTCGTGGGACGCGGTGGGCGACAACCCCTTCTTCGCCCCCAATGCGGAGATCGTGCC
GCAGCTCGAAAGCTACATGGACGAATTGCGCAAATCGGGCGACTCGGTTGGCGCACGCATCAACGTCGTCGCCAGCGGCG
TGCCCGTGGGCTGGGGCGAGCCGGTGTACGACCGCCTGGATGCCGACATTGCCTACGCGATGATGAGCATCAACGCGGTC
AAGGGCGTGGAGATCGGCGCCGGCTTCGCGTCCGTTGCGCAGCTTGGCACCGAGCATGGCGACGAACTCACGCCGGAAGG
TTTCCTGTCCAATAACGCCGGTGGCGTGCTGGGCGGCATTTCCTCCGGCCAGGACGTGCTGGTGAGCATGGCGATCAAGC
CCACCTCCAGCATCCGGCTCGACCGCCGCTCGATCGACCGCGAGGGCAATCCGGTTATCGTCAATACTCATGGCCGCCAC
GACCCCTGCGTCGGCATCCGCGCCACGCCGGTTGCCGAGGCCATGCTGGCGCTGGTGCTGATGGACCACGCCTTGCGTCA
CCGCGCCCAGTGCGGCGACGTCCGTACCGCCACGCCGCAGATTGCCGCGCTGGCGCCCGAGGGCGTGCAGGCGGTGCCGT
CGCCACGCGCGGAGTGA

Upstream 100 bases:

>100_bases
GAGGGCGGCGGGGCGCGTGTGCTAAACTCCGTCGCCTGTCCCGGCCGCCTCCGCGGCCCGCAACCGGCCGCTTTCCGGCT
GTCTTTCGGCGAGTTTCCCC

Downstream 100 bases:

>100_bases
CGACGGCAGGCGGCAGCGGGGCGGGCCTTCCTTACTGGCGGCTGTCCGCGTACTACTTCAGCTATTTCGCCTTTGTCGGG
GCGTTTTCGCCCTACTTCAC

Product: chorismate synthase

Products: NA

Alternate protein names: 5-enolpyruvylshikimate-3-phosphate phospholyase

Number of amino acids: Translated: 378; Mature: 377

Protein sequence:

>378_residues
MSGNTLGTLFCVTSFGESHGPAIGCVIDGCPPGLSLTAADIQGELDRRKPGTSRHVTQRREPDEVEILSGVFEGVTTGTP
IALLIRNQDQRSKDYGNIAETFRPGHADYPYWQKYGIRDYRGGGRSSARETAVRVAAGAVARKWLSERYGIVIRGYMAQL
GPLPIPFVSWDAVGDNPFFAPNAEIVPQLESYMDELRKSGDSVGARINVVASGVPVGWGEPVYDRLDADIAYAMMSINAV
KGVEIGAGFASVAQLGTEHGDELTPEGFLSNNAGGVLGGISSGQDVLVSMAIKPTSSIRLDRRSIDREGNPVIVNTHGRH
DPCVGIRATPVAEAMLALVLMDHALRHRAQCGDVRTATPQIAALAPEGVQAVPSPRAE

Sequences:

>Translated_378_residues
MSGNTLGTLFCVTSFGESHGPAIGCVIDGCPPGLSLTAADIQGELDRRKPGTSRHVTQRREPDEVEILSGVFEGVTTGTP
IALLIRNQDQRSKDYGNIAETFRPGHADYPYWQKYGIRDYRGGGRSSARETAVRVAAGAVARKWLSERYGIVIRGYMAQL
GPLPIPFVSWDAVGDNPFFAPNAEIVPQLESYMDELRKSGDSVGARINVVASGVPVGWGEPVYDRLDADIAYAMMSINAV
KGVEIGAGFASVAQLGTEHGDELTPEGFLSNNAGGVLGGISSGQDVLVSMAIKPTSSIRLDRRSIDREGNPVIVNTHGRH
DPCVGIRATPVAEAMLALVLMDHALRHRAQCGDVRTATPQIAALAPEGVQAVPSPRAE
>Mature_377_residues
SGNTLGTLFCVTSFGESHGPAIGCVIDGCPPGLSLTAADIQGELDRRKPGTSRHVTQRREPDEVEILSGVFEGVTTGTPI
ALLIRNQDQRSKDYGNIAETFRPGHADYPYWQKYGIRDYRGGGRSSARETAVRVAAGAVARKWLSERYGIVIRGYMAQLG
PLPIPFVSWDAVGDNPFFAPNAEIVPQLESYMDELRKSGDSVGARINVVASGVPVGWGEPVYDRLDADIAYAMMSINAVK
GVEIGAGFASVAQLGTEHGDELTPEGFLSNNAGGVLGGISSGQDVLVSMAIKPTSSIRLDRRSIDREGNPVIVNTHGRHD
PCVGIRATPVAEAMLALVLMDHALRHRAQCGDVRTATPQIAALAPEGVQAVPSPRAE

Specific function: Aromatic amino acids biosynthesis; shikimate pathway; seventh step. [C]

COG id: COG0082

COG function: function code E; Chorismate synthase

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the chorismate synthase family

Homologues:

Organism=Escherichia coli, GI1788669, Length=360, Percent_Identity=65, Blast_Score=471, Evalue=1e-134,
Organism=Saccharomyces cerevisiae, GI6321290, Length=367, Percent_Identity=41.6893732970027, Blast_Score=290, Evalue=2e-79,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): AROC_AZOSB (A1K498)

Other databases:

- EMBL:   AM406670
- RefSeq:   YP_932540.1
- ProteinModelPortal:   A1K498
- SMR:   A1K498
- STRING:   A1K498
- GeneID:   4609076
- GenomeReviews:   AM406670_GR
- KEGG:   azo:azo1036
- eggNOG:   COG0082
- HOGENOM:   HBG292336
- OMA:   SRFTTQR
- PhylomeDB:   A1K498
- ProtClustDB:   PRK05382
- BioCyc:   ASP62928:AZO1036-MONOMER
- HAMAP:   MF_00300_B
- InterPro:   IPR000453
- InterPro:   IPR020541
- PANTHER:   PTHR21085
- PIRSF:   PIRSF001456
- TIGRFAMs:   TIGR00033

Pfam domain/function: PF01264 Chorismate_synt; SSF103263 Chorismate_synth

EC number: =4.2.3.5

Molecular weight: Translated: 40255; Mature: 40124

Theoretical pI: Translated: 5.88; Mature: 5.88

Prosite motif: PS00787 CHORISMATE_SYNTHASE_1; PS00788 CHORISMATE_SYNTHASE_2; PS00789 CHORISMATE_SYNTHASE_3

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.3 %Cys     (Translated Protein)
2.1 %Met     (Translated Protein)
3.4 %Cys+Met (Translated Protein)
1.3 %Cys     (Mature Protein)
1.9 %Met     (Mature Protein)
3.2 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSGNTLGTLFCVTSFGESHGPAIGCVIDGCPPGLSLTAADIQGELDRRKPGTSRHVTQRR
CCCCCEEEEEEEECCCCCCCCEEEEEEECCCCCCEEEHHHHHCHHHCCCCCCCHHHHHCC
EPDEVEILSGVFEGVTTGTPIALLIRNQDQRSKDYGNIAETFRPGHADYPYWQKYGIRDY
CCCHHHHHHHHHHHCCCCCCEEEEEECCCCCCCHHCCHHHHCCCCCCCCCHHHHCCCCCC
RGGGRSSARETAVRVAAGAVARKWLSERYGIVIRGYMAQLGPLPIPFVSWDAVGDNPFFA
CCCCCCHHHHHHHHHHHHHHHHHHHHHHCCEEEEEHHHHCCCCCCCEEEECCCCCCCCCC
PNAEIVPQLESYMDELRKSGDSVGARINVVASGVPVGWGEPVYDRLDADIAYAMMSINAV
CCCHHHHHHHHHHHHHHHCCCCCCCEEEEEECCCCCCCCCHHHHHHHHHHHHHHHHHHHH
KGVEIGAGFASVAQLGTEHGDELTPEGFLSNNAGGVLGGISSGQDVLVSMAIKPTSSIRL
CCCEECCCHHHHHHHHHCCCCCCCCCCCCCCCCCCEEECCCCCCEEEEEEEECCCCCEEE
DRRSIDREGNPVIVNTHGRHDPCVGIRATPVAEAMLALVLMDHALRHRAQCGDVRTATPQ
CHHHCCCCCCEEEEECCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCC
IAALAPEGVQAVPSPRAE
CEEECCCCCCCCCCCCCC
>Mature Secondary Structure 
SGNTLGTLFCVTSFGESHGPAIGCVIDGCPPGLSLTAADIQGELDRRKPGTSRHVTQRR
CCCCEEEEEEEECCCCCCCCEEEEEEECCCCCCEEEHHHHHCHHHCCCCCCCHHHHHCC
EPDEVEILSGVFEGVTTGTPIALLIRNQDQRSKDYGNIAETFRPGHADYPYWQKYGIRDY
CCCHHHHHHHHHHHCCCCCCEEEEEECCCCCCCHHCCHHHHCCCCCCCCCHHHHCCCCCC
RGGGRSSARETAVRVAAGAVARKWLSERYGIVIRGYMAQLGPLPIPFVSWDAVGDNPFFA
CCCCCCHHHHHHHHHHHHHHHHHHHHHHCCEEEEEHHHHCCCCCCCEEEECCCCCCCCCC
PNAEIVPQLESYMDELRKSGDSVGARINVVASGVPVGWGEPVYDRLDADIAYAMMSINAV
CCCHHHHHHHHHHHHHHHCCCCCCCEEEEEECCCCCCCCCHHHHHHHHHHHHHHHHHHHH
KGVEIGAGFASVAQLGTEHGDELTPEGFLSNNAGGVLGGISSGQDVLVSMAIKPTSSIRL
CCCEECCCHHHHHHHHHCCCCCCCCCCCCCCCCCCEEECCCCCCEEEEEEEECCCCCEEE
DRRSIDREGNPVIVNTHGRHDPCVGIRATPVAEAMLALVLMDHALRHRAQCGDVRTATPQ
CHHHCCCCCCEEEEECCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCC
IAALAPEGVQAVPSPRAE
CEEECCCCCCCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA