Definition Francisella tularensis subsp. tularensis WY96-3418, complete genome.
Accession NC_009257
Length 1,898,476

Click here to switch to the map view.

The map label for this gene is aroC

Identifier: 134302230

GI number: 134302230

Start: 1235569

End: 1236627

Strand: Direct

Name: aroC

Synonym: FTW_1304

Alternate gene names: 134302230

Gene position: 1235569-1236627 (Clockwise)

Preceding gene: 134302229

Following gene: 134302231

Centisome position: 65.08

GC content: 38.72

Gene sequence:

>1059_bases
ATGTCAGGAAATACTTTTGGTAAAATTTTTACAGTAACCACTTGTGGCGAGAGTCATGGCGATTCACTTGCAGCTATTAT
TGATGGCTGTCCTAGCAATATACCTCTTTGTGAGGCAGATATTCAATTAGAACTAGATAGACGCAAACCAGGCCAATCAA
AATTCACCACTCAGCGTAAAGAGCCTGATGAAGTTAAGATAATTTCTGGTGTTTTTGAGGGTAAAACTACAGGTACGCCT
ATCGGTCTGATAATAAAAAACCAAGATCAAAAATCAAAAGACTATAGTGAAATAAAAGACAAATTTCGTCCTGGTCATGC
TGATTATACCTACTTCAAAAAATACGGTATTCGTGACTATCGTGGTGGTGGTAGATCATCAGCAAGAGAAACAGCAATGC
GTGTGGCAGCTGGAGCAATAGCTAAGAAAATACTCAAACATTACGGCATCGAGATCTATGGCTTCTGCTCACAGATCGGT
AGTCTTAAGATAGATTTTATTGATAAAGATTTTATAAATCAGAATCCTTTTTTTATTGCCAATAAAAATGCAGTTCCAGC
TTGCGAGGATTTAATTCACAGCATTCGCAAGCAAGGTGACTCTATTGGTGCTGAGGTAACTGTAGTAGCAACAGGTCTAG
AGGCAGGATTAGGTAGACCAGTTTTTGATCGACTTGATGCTAGTATTGCTTATGCAATGATGAGTATAAATGCTGTCAAA
GCAGTCAGTATTGGCGATGGCTTTGACTGTGTTGCACAGAAAGGTAGTCAACATCGTGATGAAATTACCCAACAGCAAGG
CTTTTTATCAAACCATGCTGGAGGAATTTTAGGTGGTATATCAACAGGTCAAGATATAATTGCTAAATTAGCTTTCAAAC
CAACATCAAGTATCCTACAACCAGGTAAGAGTATTGATGTACAAGGTAACGATACTACTGTTATCACCAAAGGTAGACAT
GATCCTTGTGTTGGCATCAGAGGTGTACCAATAGCTGAGGCGATGTTAGCACTAGTTTTAGTTGATGAACTCCTAATTAC
GCGATCTTATAGGGATTAG

Upstream 100 bases:

>100_bases
GGTCAAATTATTTTTTTGTGAAAAAATCAACATTAGATAACATAAAATCACTTCTTATTTATGCTATCATAAAAAAACAA
GCTACTTATTATTATGCATA

Downstream 100 bases:

>100_bases
ACATGAGTGAAAGTGAATTCTCAAGCTTACTAATTGATTGGGGATATTTAGCTATCATGCTAGGGGTTTTTATCGAAGGT
GAAATATTCTTAATTATGGT

Product: chorismate synthase

Products: NA

Alternate protein names: 5-enolpyruvylshikimate-3-phosphate phospholyase

Number of amino acids: Translated: 352; Mature: 351

Protein sequence:

>352_residues
MSGNTFGKIFTVTTCGESHGDSLAAIIDGCPSNIPLCEADIQLELDRRKPGQSKFTTQRKEPDEVKIISGVFEGKTTGTP
IGLIIKNQDQKSKDYSEIKDKFRPGHADYTYFKKYGIRDYRGGGRSSARETAMRVAAGAIAKKILKHYGIEIYGFCSQIG
SLKIDFIDKDFINQNPFFIANKNAVPACEDLIHSIRKQGDSIGAEVTVVATGLEAGLGRPVFDRLDASIAYAMMSINAVK
AVSIGDGFDCVAQKGSQHRDEITQQQGFLSNHAGGILGGISTGQDIIAKLAFKPTSSILQPGKSIDVQGNDTTVITKGRH
DPCVGIRGVPIAEAMLALVLVDELLITRSYRD

Sequences:

>Translated_352_residues
MSGNTFGKIFTVTTCGESHGDSLAAIIDGCPSNIPLCEADIQLELDRRKPGQSKFTTQRKEPDEVKIISGVFEGKTTGTP
IGLIIKNQDQKSKDYSEIKDKFRPGHADYTYFKKYGIRDYRGGGRSSARETAMRVAAGAIAKKILKHYGIEIYGFCSQIG
SLKIDFIDKDFINQNPFFIANKNAVPACEDLIHSIRKQGDSIGAEVTVVATGLEAGLGRPVFDRLDASIAYAMMSINAVK
AVSIGDGFDCVAQKGSQHRDEITQQQGFLSNHAGGILGGISTGQDIIAKLAFKPTSSILQPGKSIDVQGNDTTVITKGRH
DPCVGIRGVPIAEAMLALVLVDELLITRSYRD
>Mature_351_residues
SGNTFGKIFTVTTCGESHGDSLAAIIDGCPSNIPLCEADIQLELDRRKPGQSKFTTQRKEPDEVKIISGVFEGKTTGTPI
GLIIKNQDQKSKDYSEIKDKFRPGHADYTYFKKYGIRDYRGGGRSSARETAMRVAAGAIAKKILKHYGIEIYGFCSQIGS
LKIDFIDKDFINQNPFFIANKNAVPACEDLIHSIRKQGDSIGAEVTVVATGLEAGLGRPVFDRLDASIAYAMMSINAVKA
VSIGDGFDCVAQKGSQHRDEITQQQGFLSNHAGGILGGISTGQDIIAKLAFKPTSSILQPGKSIDVQGNDTTVITKGRHD
PCVGIRGVPIAEAMLALVLVDELLITRSYRD

Specific function: Aromatic amino acids biosynthesis; shikimate pathway; seventh step. [C]

COG id: COG0082

COG function: function code E; Chorismate synthase

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the chorismate synthase family

Homologues:

Organism=Escherichia coli, GI1788669, Length=350, Percent_Identity=66.5714285714286, Blast_Score=453, Evalue=1e-129,
Organism=Saccharomyces cerevisiae, GI6321290, Length=369, Percent_Identity=46.3414634146341, Blast_Score=292, Evalue=5e-80,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): AROC_FRAT1 (Q14HW8)

Other databases:

- EMBL:   AM286280
- RefSeq:   YP_667008.1
- ProteinModelPortal:   Q14HW8
- SMR:   Q14HW8
- STRING:   Q14HW8
- GeneID:   4199433
- GenomeReviews:   AM286280_GR
- KEGG:   ftf:FTF0876c
- eggNOG:   COG0082
- HOGENOM:   HBG292336
- OMA:   SRFTTQR
- PhylomeDB:   Q14HW8
- ProtClustDB:   PRK05382
- BioCyc:   FTUL393115:FTF0876C-MONOMER
- HAMAP:   MF_00300_B
- InterPro:   IPR000453
- InterPro:   IPR020541
- PANTHER:   PTHR21085
- PIRSF:   PIRSF001456
- TIGRFAMs:   TIGR00033

Pfam domain/function: PF01264 Chorismate_synt; SSF103263 Chorismate_synth

EC number: =4.2.3.5

Molecular weight: Translated: 38021; Mature: 37890

Theoretical pI: Translated: 8.05; Mature: 8.05

Prosite motif: PS00787 CHORISMATE_SYNTHASE_1; PS00788 CHORISMATE_SYNTHASE_2; PS00789 CHORISMATE_SYNTHASE_3

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

2.0 %Cys     (Translated Protein)
1.4 %Met     (Translated Protein)
3.4 %Cys+Met (Translated Protein)
2.0 %Cys     (Mature Protein)
1.1 %Met     (Mature Protein)
3.1 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSGNTFGKIFTVTTCGESHGDSLAAIIDGCPSNIPLCEADIQLELDRRKPGQSKFTTQRK
CCCCCEEEEEEEEECCCCCCCCEEEEECCCCCCCCEEECCEEEEECCCCCCCCCCCCCCC
EPDEVKIISGVFEGKTTGTPIGLIIKNQDQKSKDYSEIKDKFRPGHADYTYFKKYGIRDY
CCCCEEEEEHHHCCCCCCCCEEEEEECCCCCCCHHHHHHHHHCCCCCCHHHHHHCCCCCC
RGGGRSSARETAMRVAAGAIAKKILKHYGIEIYGFCSQIGSLKIDFIDKDFINQNPFFIA
CCCCCCHHHHHHHHHHHHHHHHHHHHHHCCEEEEEHHHHCCEEEEEECHHHCCCCCEEEE
NKNAVPACEDLIHSIRKQGDSIGAEVTVVATGLEAGLGRPVFDRLDASIAYAMMSINAVK
CCCCCCHHHHHHHHHHHCCCCCCCEEEEEEECHHHCCCCHHHHHHHHHHHHHHHHHHHEE
AVSIGDGFDCVAQKGSQHRDEITQQQGFLSNHAGGILGGISTGQDIIAKLAFKPTSSILQ
EEECCCCHHHHHHCCCHHHHHHHHHHCCHHCCCCCEEECCCCCHHHHHHHHCCCCHHHHC
PGKSIDVQGNDTTVITKGRHDPCVGIRGVPIAEAMLALVLVDELLITRSYRD
CCCEEEECCCCEEEEECCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHCCCC
>Mature Secondary Structure 
SGNTFGKIFTVTTCGESHGDSLAAIIDGCPSNIPLCEADIQLELDRRKPGQSKFTTQRK
CCCCEEEEEEEEECCCCCCCCEEEEECCCCCCCCEEECCEEEEECCCCCCCCCCCCCCC
EPDEVKIISGVFEGKTTGTPIGLIIKNQDQKSKDYSEIKDKFRPGHADYTYFKKYGIRDY
CCCCEEEEEHHHCCCCCCCCEEEEEECCCCCCCHHHHHHHHHCCCCCCHHHHHHCCCCCC
RGGGRSSARETAMRVAAGAIAKKILKHYGIEIYGFCSQIGSLKIDFIDKDFINQNPFFIA
CCCCCCHHHHHHHHHHHHHHHHHHHHHHCCEEEEEHHHHCCEEEEEECHHHCCCCCEEEE
NKNAVPACEDLIHSIRKQGDSIGAEVTVVATGLEAGLGRPVFDRLDASIAYAMMSINAVK
CCCCCCHHHHHHHHHHHCCCCCCCEEEEEEECHHHCCCCHHHHHHHHHHHHHHHHHHHEE
AVSIGDGFDCVAQKGSQHRDEITQQQGFLSNHAGGILGGISTGQDIIAKLAFKPTSSILQ
EEECCCCHHHHHHCCCHHHHHHHHHHCCHHCCCCCEEECCCCCHHHHHHHHCCCCHHHHC
PGKSIDVQGNDTTVITKGRHDPCVGIRGVPIAEAMLALVLVDELLITRSYRD
CCCEEEECCCCEEEEECCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: NA