| Definition | Chlorobium tepidum TLS, complete genome. |
|---|---|
| Accession | NC_002932 |
| Length | 2,154,946 |
Click here to switch to the map view.
The map label for this gene is aroC
Identifier: 21674253
GI number: 21674253
Start: 1344156
End: 1345349
Strand: Direct
Name: aroC
Synonym: CT1432
Alternate gene names: 21674253
Gene position: 1344156-1345349 (Clockwise)
Preceding gene: 21674252
Following gene: 21674255
Centisome position: 62.38
GC content: 63.23
Gene sequence:
>1194_bases ATGATCCGTTACTTCACCGCAGGCGAATCGCACGGCCCGGCGCTTTCAGCAATCGTCGAGGGAATGCCCGCAGGCGTGGC GCTGACCGAATCCGACATCAACGACCAGCTCGCCCGCCGCCAGCAGGGTTACGGTCGTGGCGGCCGCATGAAGATCGAGA CCGACCGTGCCGAGGTGCTCTCCGGCGTCCGGTTCGGCAAAACCATCGGCTCGCCCGTCGCGATGCTCATCCGCAACCGT GACTGGGAGAACTGGACAACATCGATGGCGCAGTTCGAAGACCACGCCACCGAGGTGCAGAAGATCACCATCCCCCGCCC CGGCCACGCCGACCTGACCGGCTTCGTGAAATACGGCTTCGACGACATTCGCCCGGTCATCGACCGCTCCTCGGCCCGCG AAACCGCCGCCAGAGTCGCTGCCGGATCGCTCGCACGAGCATTTTTGAGACAGCTCGGCATCCAGATTGGAAGCTACATC TCCACCATAGGTCCCGTCTCCGAAGCCGCCGCCCCCGCCTCGTTGCAGGAGCTGCTCGACGCCGGAGCTGAAAGCCTCGC CGCCGAAGCCGACAAATCGCCGGTGCGGATGCTCGACCCGGAAGCAGAAACCGCAGCCATCGCGGCTATCGACCAGGCCA AAGCCGATGGCGACACTCTCGGTGGCATCGTCGAACTCTACATCACCGGCGTACCAATGGGCCTCGGCAGCTACGTCCAG CACGACCGCCGGCTCGACTCGGAACTCGCCGCCGCAATCATGTCTATCCAGGCGATCAAAGGCGTCGAAATCGGTCCGGC CTTCGACAACGCCCGCAAACCAGGTTCCCAGGTACACGACGAACTGTTCGCCGGTGGTGAAAAGGGATTGAGACGCGAAA CCAACCGAGCTGGAGGCATCGAAGGCAGCATGTCAAGCGGCCAGCCGATCCACATCCGCGCCGCCATGAAACCGATCTCC TCGCTCGTCTCCCCGCTCAGCTCTTTCGACCTCGCCACACTCGAAGCCGTGCAGTCACGCTTCGAACGCAGCGACACCTG CGCCGTCCCCGCCGCCGGAGTCGTCGCCGAAGCCGTCGTAGCCCCCGTCATCGCCAACGCGCTGTTGGAAAAACTTGGCG GAGATCATATGGCGGAGATTAAGGAAAGGCTGGAGGTTTATCGGGCGGCGCTGAGGATGAGGTTTGAAAAATAA
Upstream 100 bases:
>100_bases CTTGAAACTCGAACATCTTTGTAGGGGTATCCCGACAAGTCGCGATACCCTTTTATGATGCGCCCAAAAACAACCGATAC ATTTTTCTCACCACACTGAC
Downstream 100 bases:
>100_bases CTACAAACCGCCTTAAAAAGCCTCTTTTTTAAAGAGGCTTTTTTGTGGGTCTGACAACGATACTCTATCCATTCCTGCAT AACCTGGATGTATCAAACCC
Product: chorismate synthase
Products: NA
Alternate protein names: 5-enolpyruvylshikimate-3-phosphate phospholyase
Number of amino acids: Translated: 397; Mature: 397
Protein sequence:
>397_residues MIRYFTAGESHGPALSAIVEGMPAGVALTESDINDQLARRQQGYGRGGRMKIETDRAEVLSGVRFGKTIGSPVAMLIRNR DWENWTTSMAQFEDHATEVQKITIPRPGHADLTGFVKYGFDDIRPVIDRSSARETAARVAAGSLARAFLRQLGIQIGSYI STIGPVSEAAAPASLQELLDAGAESLAAEADKSPVRMLDPEAETAAIAAIDQAKADGDTLGGIVELYITGVPMGLGSYVQ HDRRLDSELAAAIMSIQAIKGVEIGPAFDNARKPGSQVHDELFAGGEKGLRRETNRAGGIEGSMSSGQPIHIRAAMKPIS SLVSPLSSFDLATLEAVQSRFERSDTCAVPAAGVVAEAVVAPVIANALLEKLGGDHMAEIKERLEVYRAALRMRFEK
Sequences:
>Translated_397_residues MIRYFTAGESHGPALSAIVEGMPAGVALTESDINDQLARRQQGYGRGGRMKIETDRAEVLSGVRFGKTIGSPVAMLIRNR DWENWTTSMAQFEDHATEVQKITIPRPGHADLTGFVKYGFDDIRPVIDRSSARETAARVAAGSLARAFLRQLGIQIGSYI STIGPVSEAAAPASLQELLDAGAESLAAEADKSPVRMLDPEAETAAIAAIDQAKADGDTLGGIVELYITGVPMGLGSYVQ HDRRLDSELAAAIMSIQAIKGVEIGPAFDNARKPGSQVHDELFAGGEKGLRRETNRAGGIEGSMSSGQPIHIRAAMKPIS SLVSPLSSFDLATLEAVQSRFERSDTCAVPAAGVVAEAVVAPVIANALLEKLGGDHMAEIKERLEVYRAALRMRFEK >Mature_397_residues MIRYFTAGESHGPALSAIVEGMPAGVALTESDINDQLARRQQGYGRGGRMKIETDRAEVLSGVRFGKTIGSPVAMLIRNR DWENWTTSMAQFEDHATEVQKITIPRPGHADLTGFVKYGFDDIRPVIDRSSARETAARVAAGSLARAFLRQLGIQIGSYI STIGPVSEAAAPASLQELLDAGAESLAAEADKSPVRMLDPEAETAAIAAIDQAKADGDTLGGIVELYITGVPMGLGSYVQ HDRRLDSELAAAIMSIQAIKGVEIGPAFDNARKPGSQVHDELFAGGEKGLRRETNRAGGIEGSMSSGQPIHIRAAMKPIS SLVSPLSSFDLATLEAVQSRFERSDTCAVPAAGVVAEAVVAPVIANALLEKLGGDHMAEIKERLEVYRAALRMRFEK
Specific function: Aromatic amino acids biosynthesis; shikimate pathway; seventh step. [C]
COG id: COG0082
COG function: function code E; Chorismate synthase
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the chorismate synthase family
Homologues:
Organism=Escherichia coli, GI1788669, Length=372, Percent_Identity=36.8279569892473, Blast_Score=176, Evalue=2e-45, Organism=Saccharomyces cerevisiae, GI6321290, Length=376, Percent_Identity=33.7765957446808, Blast_Score=190, Evalue=4e-49,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): AROC_CHLTE (Q8KCI9)
Other databases:
- EMBL: AE006470 - RefSeq: NP_662318.1 - ProteinModelPortal: Q8KCI9 - SMR: Q8KCI9 - GeneID: 1005980 - GenomeReviews: AE006470_GR - KEGG: cte:CT1432 - NMPDR: fig|194439.1.peg.1412 - TIGR: CT1432 - HOGENOM: HBG292336 - OMA: GSEAHDE - ProtClustDB: PRK05382 - BioCyc: CTEP194439:CT_1432-MONOMER - BRENDA: 4.2.3.5 - HAMAP: MF_00300_B - InterPro: IPR000453 - InterPro: IPR020541 - PANTHER: PTHR21085 - PIRSF: PIRSF001456 - TIGRFAMs: TIGR00033
Pfam domain/function: PF01264 Chorismate_synt; SSF103263 Chorismate_synth
EC number: =4.2.3.5
Molecular weight: Translated: 42278; Mature: 42278
Theoretical pI: Translated: 5.34; Mature: 5.34
Prosite motif: PS00787 CHORISMATE_SYNTHASE_1; PS00788 CHORISMATE_SYNTHASE_2; PS00789 CHORISMATE_SYNTHASE_3
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.3 %Cys (Translated Protein) 3.0 %Met (Translated Protein) 3.3 %Cys+Met (Translated Protein) 0.3 %Cys (Mature Protein) 3.0 %Met (Mature Protein) 3.3 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MIRYFTAGESHGPALSAIVEGMPAGVALTESDINDQLARRQQGYGRGGRMKIETDRAEVL CEEEEECCCCCCHHHHHHHCCCCCCEEEEHHHHHHHHHHHHHCCCCCCCEEEECCHHHHH SGVRFGKTIGSPVAMLIRNRDWENWTTSMAQFEDHATEVQKITIPRPGHADLTGFVKYGF HHHHHHHHHCHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHEEECCCCCCCCHHHHHHHCH DDIRPVIDRSSARETAARVAAGSLARAFLRQLGIQIGSYISTIGPVSEAAAPASLQELLD HHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHCCCHHHHHHHH AGAESLAAEADKSPVRMLDPEAETAAIAAIDQAKADGDTLGGIVELYITGVPMGLGSYVQ HCHHHHHHHCCCCCCEEECCCHHHHHHHHHHHHCCCCCHHHHHHHHHHHCCCCCHHHHHH HDRRLDSELAAAIMSIQAIKGVEIGPAFDNARKPGSQVHDELFAGGEKGLRRETNRAGGI HHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCHHHHHHHHHCCCHHHHHHHHHCCCCC EGSMSSGQPIHIRAAMKPISSLVSPLSSFDLATLEAVQSRFERSDTCAVPAAGVVAEAVV CCCCCCCCCEEEHHHHHHHHHHHHHHHHCHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHH APVIANALLEKLGGDHMAEIKERLEVYRAALRMRFEK HHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHCCC >Mature Secondary Structure MIRYFTAGESHGPALSAIVEGMPAGVALTESDINDQLARRQQGYGRGGRMKIETDRAEVL CEEEEECCCCCCHHHHHHHCCCCCCEEEEHHHHHHHHHHHHHCCCCCCCEEEECCHHHHH SGVRFGKTIGSPVAMLIRNRDWENWTTSMAQFEDHATEVQKITIPRPGHADLTGFVKYGF HHHHHHHHHCHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHEEECCCCCCCCHHHHHHHCH DDIRPVIDRSSARETAARVAAGSLARAFLRQLGIQIGSYISTIGPVSEAAAPASLQELLD HHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHCCCHHHHHHHH AGAESLAAEADKSPVRMLDPEAETAAIAAIDQAKADGDTLGGIVELYITGVPMGLGSYVQ HCHHHHHHHCCCCCCEEECCCHHHHHHHHHHHHCCCCCHHHHHHHHHHHCCCCCHHHHHH HDRRLDSELAAAIMSIQAIKGVEIGPAFDNARKPGSQVHDELFAGGEKGLRRETNRAGGI HHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCHHHHHHHHHCCCHHHHHHHHHCCCCC EGSMSSGQPIHIRAAMKPISSLVSPLSSFDLATLEAVQSRFERSDTCAVPAAGVVAEAVV CCCCCCCCCEEEHHHHHHHHHHHHHHHHCHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHH APVIANALLEKLGGDHMAEIKERLEVYRAALRMRFEK HHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 12093901