| Definition | Chlorobium tepidum TLS, complete genome. |
|---|---|
| Accession | NC_002932 |
| Length | 2,154,946 |
Click here to switch to the map view.
The map label for this gene is aroA
Identifier: 21674730
GI number: 21674730
Start: 1813535
End: 1814839
Strand: Reverse
Name: aroA
Synonym: CT1918
Alternate gene names: 21674730
Gene position: 1814839-1813535 (Counterclockwise)
Preceding gene: 21674731
Following gene: 21674729
Centisome position: 84.22
GC content: 64.67
Gene sequence:
>1305_bases ATGAGCACTTTTCAGGGCGAGGTGACGACCCTTCCGCCGGACAAATCGATTTCGCATCGCGCCGCGCTTATCGGCGCGCT CGCCGAAGGCACGACCGAGATTTCCAACTTTTCGGGTGGATACGATAACCAGTCAACCCTGTCGGTGCTGCGCGATGCCG GTATTTCCATTCGACAGGAGGAGCTTTCCGCCGGTGACGGGCGGATCGAGCGGCGCGTGGTGATCGAGTCGAACGGCCTC TGGAGTTTCCGTGAGCCCTCCGTGCCGCTGATGTGCAACAACTCCGGCAGTACGATGCGCATGATGGCGGGTATTATGGC CGCGCAGCCTTTCCGGAGCGAGCTGGTGGGTGACGCTTCGCTGATGAAGCGCCCGATGAAGCGCGTCGCCGATCCGCTGC GGCAGATGGGCGCCGAAATTTCGCTTTCCGACGCCGGAACCGCGCCGGTCGTCATCCACGGCACCAAAGCGCTGAAGACG ATCGAGTACCGTCTGCCGGTGCCCTCGGCGCAGGTGAAGTCGCTCGTGGCCTTTGCGGCGCTGCACGCCGATGGCCAGTC GAAAATCATCGAGCCGATCCGTTCGCGCGACCATACCGAGCTGATGCTGGGCCTCGCAACCATCGATCGGCCCGACGGCG TTCGCGAGATCATCATCGACGGGCGCAAGCCGATTGCCGCCAAACCGTTCAAGGTACCCGCCGATCCCTCGGCGGCCTGC TTCATGATCGCCCTCGGCCTGCTCGGCGAGCGCTCGGAGATCGTGCTGCGCAACGTCTGCCTCAATCCGACGCGCGTGGC CTACATCGACGTGTTGCAGGAGGCGGGCGCGGGCCTCGGCATCGAGAACGTGCGTTCGGAGGGCGGCGAGCCGGTGGGTG ATATCGTCGTCCGGAGCTGCTCCGGCTTGAAGCCGCTGCGCATCAGCGACCACGGCGTTGTGGCTGGGGTGATCGACGAG GTGCCGATGCTTGCCGTGCTCTCGGCCTTCGCCTCGGGCGAGTTCGAGCTGCACAACGCCGCCGAGCTGCGCACCAAGGA GAGCGACCGCATCGACGCGCTGGTGGTGAATCTTCAGCGTCTCGGCTTCGAGTGCGAGCAGTACGCCGATGGCTTTGTGG TGAAGGGACGGAAAACCGTCGCTTCAGAAGAGGTTGAGATCGAGTGCTTCGACGACCACCGCATCGCCATGAGCTTCACC ATCGCCGCCGAAGCCGCCGGCGCATCGCTGCGCCTCTCGGATCGCGACGTGGCGGGCGTGTCGTTCCCGAATTTCTTCGC CCTGATCGACTCGCTGCGGCAGTAG
Upstream 100 bases:
>100_bases GCGCTAACGAAGAGCGCAACTCCTGATTTTTCAGGAATTCAGTATTGAAAAGCAGCTCCCTTGGGGCTGCTTTTTTTATC GAACTCAAAAACAGCCAGCA
Downstream 100 bases:
>100_bases GGGGGAGAAGGGTAGGGGCGGGAATTTTCCCTGGGAGCGCCGAGCGCCTGCTCGGCAATGGAGCTGGAGGCTCCGCATCA TGCTTTTACGATTCTTTCGA
Product: 3-phosphoshikimate 1-carboxyvinyltransferase
Products: NA
Alternate protein names: 5-enolpyruvylshikimate-3-phosphate synthase; EPSP synthase; EPSPS
Number of amino acids: Translated: 434; Mature: 433
Protein sequence:
>434_residues MSTFQGEVTTLPPDKSISHRAALIGALAEGTTEISNFSGGYDNQSTLSVLRDAGISIRQEELSAGDGRIERRVVIESNGL WSFREPSVPLMCNNSGSTMRMMAGIMAAQPFRSELVGDASLMKRPMKRVADPLRQMGAEISLSDAGTAPVVIHGTKALKT IEYRLPVPSAQVKSLVAFAALHADGQSKIIEPIRSRDHTELMLGLATIDRPDGVREIIIDGRKPIAAKPFKVPADPSAAC FMIALGLLGERSEIVLRNVCLNPTRVAYIDVLQEAGAGLGIENVRSEGGEPVGDIVVRSCSGLKPLRISDHGVVAGVIDE VPMLAVLSAFASGEFELHNAAELRTKESDRIDALVVNLQRLGFECEQYADGFVVKGRKTVASEEVEIECFDDHRIAMSFT IAAEAAGASLRLSDRDVAGVSFPNFFALIDSLRQ
Sequences:
>Translated_434_residues MSTFQGEVTTLPPDKSISHRAALIGALAEGTTEISNFSGGYDNQSTLSVLRDAGISIRQEELSAGDGRIERRVVIESNGL WSFREPSVPLMCNNSGSTMRMMAGIMAAQPFRSELVGDASLMKRPMKRVADPLRQMGAEISLSDAGTAPVVIHGTKALKT IEYRLPVPSAQVKSLVAFAALHADGQSKIIEPIRSRDHTELMLGLATIDRPDGVREIIIDGRKPIAAKPFKVPADPSAAC FMIALGLLGERSEIVLRNVCLNPTRVAYIDVLQEAGAGLGIENVRSEGGEPVGDIVVRSCSGLKPLRISDHGVVAGVIDE VPMLAVLSAFASGEFELHNAAELRTKESDRIDALVVNLQRLGFECEQYADGFVVKGRKTVASEEVEIECFDDHRIAMSFT IAAEAAGASLRLSDRDVAGVSFPNFFALIDSLRQ >Mature_433_residues STFQGEVTTLPPDKSISHRAALIGALAEGTTEISNFSGGYDNQSTLSVLRDAGISIRQEELSAGDGRIERRVVIESNGLW SFREPSVPLMCNNSGSTMRMMAGIMAAQPFRSELVGDASLMKRPMKRVADPLRQMGAEISLSDAGTAPVVIHGTKALKTI EYRLPVPSAQVKSLVAFAALHADGQSKIIEPIRSRDHTELMLGLATIDRPDGVREIIIDGRKPIAAKPFKVPADPSAACF MIALGLLGERSEIVLRNVCLNPTRVAYIDVLQEAGAGLGIENVRSEGGEPVGDIVVRSCSGLKPLRISDHGVVAGVIDEV PMLAVLSAFASGEFELHNAAELRTKESDRIDALVVNLQRLGFECEQYADGFVVKGRKTVASEEVEIECFDDHRIAMSFTI AAEAAGASLRLSDRDVAGVSFPNFFALIDSLRQ
Specific function: Aromatic amino acids biosynthesis; shikimate pathway; sixth step. [C]
COG id: COG0128
COG function: function code E; 5-enolpyruvylshikimate-3-phosphate synthase
Gene ontology:
Cell location: Cytoplasm
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the EPSP synthase family
Homologues:
Organism=Escherichia coli, GI1787137, Length=435, Percent_Identity=25.5172413793103, Blast_Score=83, Evalue=3e-17,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): AROA_CHLTE (Q8KB71)
Other databases:
- EMBL: AE006470 - RefSeq: NP_662795.1 - ProteinModelPortal: Q8KB71 - GeneID: 1007846 - GenomeReviews: AE006470_GR - KEGG: cte:CT1918 - NMPDR: fig|194439.1.peg.1889 - TIGR: CT1918 - HOGENOM: HBG646626 - OMA: LSRNHTE - ProtClustDB: PRK02427 - BioCyc: CTEP194439:CT_1918-MONOMER - BRENDA: 2.5.1.19 - GO: GO:0005737 - HAMAP: MF_00210 - InterPro: IPR001986 - InterPro: IPR006264 - InterPro: IPR023193 - InterPro: IPR013792 - Gene3D: G3DSA:3.65.10.10 - PIRSF: PIRSF000505 - TIGRFAMs: TIGR01356
Pfam domain/function: PF00275 EPSP_synthase; SSF55205 RNA3'_cycl/enolpyr_transf_A/B
EC number: =2.5.1.19
Molecular weight: Translated: 46627; Mature: 46496
Theoretical pI: Translated: 5.12; Mature: 5.12
Prosite motif: PS00104 EPSP_SYNTHASE_1; PS00885 EPSP_SYNTHASE_2
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.4 %Cys (Translated Protein) 3.0 %Met (Translated Protein) 4.4 %Cys+Met (Translated Protein) 1.4 %Cys (Mature Protein) 2.8 %Met (Mature Protein) 4.2 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MSTFQGEVTTLPPDKSISHRAALIGALAEGTTEISNFSGGYDNQSTLSVLRDAGISIRQE CCCCCCCEEECCCCCCCHHHHHHHHHHHCCCHHHHCCCCCCCCHHHHHHHHHCCCCEEHH ELSAGDGRIERRVVIESNGLWSFREPSVPLMCNNSGSTMRMMAGIMAAQPFRSELVGDAS HHCCCCCCEEEEEEEECCCEECCCCCCCCEEECCCCCHHHHHHHHHHCCCHHHHHCCCHH LMKRPMKRVADPLRQMGAEISLSDAGTAPVVIHGTKALKTIEYRLPVPSAQVKSLVAFAA HHHHHHHHHHHHHHHHCCEEEECCCCCCCEEEECCHHEEEEEEECCCCHHHHHHHHHHHH LHADGQSKIIEPIRSRDHTELMLGLATIDRPDGVREIIIDGRKPIAAKPFKVPADPSAAC HHCCCHHHHHHHHHCCCCHHEEEEHHHCCCCCCCHHHEECCCCCCCCCCEECCCCCCHHH FMIALGLLGERSEIVLRNVCLNPTRVAYIDVLQEAGAGLGIENVRSEGGEPVGDIVVRSC HHHHHHHCCCCCHHHHHHHCCCCCHHHHHHHHHHCCCCCCHHHHHHCCCCCHHHHHHHHC SGLKPLRISDHGVVAGVIDEVPMLAVLSAFASGEFELHNAAELRTKESDRIDALVVNLQR CCCCCEEECCCCEEEHHHHHHHHHHHHHHHHCCCEEECCHHHHCCCCCCCHHHHHHHHHH LGFECEQYADGFVVKGRKTVASEEVEIECFDDHRIAMSFTIAAEAAGASLRLSDRDVAGV HCCCHHHHCCCEEEECCCEECCCCEEEEEECCCEEEEEEEEEEECCCCEEEECCCCCCCC SFPNFFALIDSLRQ CCCHHHHHHHHHCC >Mature Secondary Structure STFQGEVTTLPPDKSISHRAALIGALAEGTTEISNFSGGYDNQSTLSVLRDAGISIRQE CCCCCCEEECCCCCCCHHHHHHHHHHHCCCHHHHCCCCCCCCHHHHHHHHHCCCCEEHH ELSAGDGRIERRVVIESNGLWSFREPSVPLMCNNSGSTMRMMAGIMAAQPFRSELVGDAS HHCCCCCCEEEEEEEECCCEECCCCCCCCEEECCCCCHHHHHHHHHHCCCHHHHHCCCHH LMKRPMKRVADPLRQMGAEISLSDAGTAPVVIHGTKALKTIEYRLPVPSAQVKSLVAFAA HHHHHHHHHHHHHHHHCCEEEECCCCCCCEEEECCHHEEEEEEECCCCHHHHHHHHHHHH LHADGQSKIIEPIRSRDHTELMLGLATIDRPDGVREIIIDGRKPIAAKPFKVPADPSAAC HHCCCHHHHHHHHHCCCCHHEEEEHHHCCCCCCCHHHEECCCCCCCCCCEECCCCCCHHH FMIALGLLGERSEIVLRNVCLNPTRVAYIDVLQEAGAGLGIENVRSEGGEPVGDIVVRSC HHHHHHHCCCCCHHHHHHHCCCCCHHHHHHHHHHCCCCCCHHHHHHCCCCCHHHHHHHHC SGLKPLRISDHGVVAGVIDEVPMLAVLSAFASGEFELHNAAELRTKESDRIDALVVNLQR CCCCCEEECCCCEEEHHHHHHHHHHHHHHHHCCCEEECCHHHHCCCCCCCHHHHHHHHHH LGFECEQYADGFVVKGRKTVASEEVEIECFDDHRIAMSFTIAAEAAGASLRLSDRDVAGV HCCCHHHHCCCEEEECCCEECCCCEEEEEECCCEEEEEEEEEEECCCCEEEECCCCCCCC SFPNFFALIDSLRQ CCCHHHHHHHHHCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 12093901