Definition Methanococcus aeolicus Nankai-3, complete genome.
Accession NC_009635
Length 1,569,500

Click here to switch to the map view.

The map label for this gene is trpE [H]

Identifier: 150401540

GI number: 150401540

Start: 1162179

End: 1163585

Strand: Direct

Name: trpE [H]

Synonym: Maeo_1117

Alternate gene names: 150401540

Gene position: 1162179-1163585 (Clockwise)

Preceding gene: 150401539

Following gene: 150401541

Centisome position: 74.05

GC content: 33.12

Gene sequence:

>1407_bases
ATGACAGATAAAACGACTACAAACAACATAACAGATGAAAACTCAAAAAAACAGATAATTAGAAAAAATTTTGATTTTGT
AGAACCTTTAAAATTATATGGATTATTGAGGGAGGAAGGAATTAACCCGTTTATATTGGAATCAAGAGATAAACACCACT
CAAAGGCGAGATTTACATATATTTCTGCAAACCCTGAATTTATTGTAAATATTAAAAATAAAACAAAAATAGATAATTCT
ACTTATTCAAATAATTCCAACCCATTTCAATCATTAAAAGAAATAAGCGACGAAATGAATGTCAATATTAAAAATTTGGA
TTCAAAAGAAAGATTTATAGGCGGATTTTTAGGATATTTTGCCTATGACTGTATTCACAACTATATTGGAGGAGATATTG
AAGAGCCTTCTGTATTTGGATATTATAATAGCGTTTTTGTTTATGACCACACCTATAAAAGATATTATTATTTAACACAT
AACAACTCTCCCGAAGAATTAAAAAATGCCGAATCCATAATAAAAAGAGCAAAAAACTACGAAATAGAAGAGGAAAAAGA
CGGAGGTTCAAATATTGCAGGTTGCGATGCTTCAAAGGAAGAACATTATAATATGGTAGAAAAGGCAAAGGAATATATAT
ATGAGGGCGATGCCTTTCAGGTTGTTATTTCAAAGGAATTTAGAGTAAATAGCGATTATTCACCATTTAAAGTATATAAA
AATCTAAGGGAAATAAATCCATCTCCCTATATGTTTTTGTTGGAATTTGAAAATAAAAGTCTTGTAGGAGCTTCCCCTGA
AACTATGGCATCTGTTGAAAACAACATATTGCAAATAAATCCCATTGCTGGAAGTACGAAAGTGGGAAAAACTGACGAAG
AATCGAAAAAACTTGCGGAGCTCCTACTTAAAGATGAAAAGGAAAGAGCCGAACATATGATGCTGGTGGATTTAGCTAGA
AATGATGTTAGAAAAGTGTGTAAATCTGGAAGCGTGGAGCTCCAAAGTTTCTTTAAAGTATTGAAATATAGTCATATTCA
ACATATTGAAAGTGAGGTAATTGGGGAGCTCCGAAATAATTATAGTCCTTATGATGCAATCGAAGCGGCATTTCCTGCTG
GGACATTAACGGGAGCTCCGAAATATAGGGCAATGGAAATAATTGACGAAATTGAAAAATCACGAAGAAAAGCATATGGT
GGAGCTGTTGGATATTTCTCACCAAATGGCTGTGCTGATACGGCAATTACCATAAGAACCGCAGAAATGGAAAAAGATGG
CACAATTAGATTAAGAGTAGGGGGCGGAATTGTGGCTGATTCTGAACCAGAAAATGAATATTTGGAAACAGAACGAAAAA
TAGCTGCGGTTATGAGGGCTTTTGATATTGTAAAGGAATATAGATAG

Upstream 100 bases:

>100_bases
CAAAGGACTATAAAGAAGGGCTAAAACTTGCAAAAGAAGTAATTGATAATGGAACTGTATTAAAAAAATTAAAAGAAATA
CAAAAATACGGGGAATAGTT

Downstream 100 bases:

>100_bases
TAAAGAGCAAACCTTTAAAAATCTCAAAATTCACTTTGTGAATTCGAAGCTAATCCTTTGGATTAGCTGACTTACAAAAC
ATTGAAAAGGTTTTGTCAAG

Product: anthranilate synthase component I

Products: NA

Alternate protein names: Anthranilate synthase component I [H]

Number of amino acids: Translated: 468; Mature: 467

Protein sequence:

>468_residues
MTDKTTTNNITDENSKKQIIRKNFDFVEPLKLYGLLREEGINPFILESRDKHHSKARFTYISANPEFIVNIKNKTKIDNS
TYSNNSNPFQSLKEISDEMNVNIKNLDSKERFIGGFLGYFAYDCIHNYIGGDIEEPSVFGYYNSVFVYDHTYKRYYYLTH
NNSPEELKNAESIIKRAKNYEIEEEKDGGSNIAGCDASKEEHYNMVEKAKEYIYEGDAFQVVISKEFRVNSDYSPFKVYK
NLREINPSPYMFLLEFENKSLVGASPETMASVENNILQINPIAGSTKVGKTDEESKKLAELLLKDEKERAEHMMLVDLAR
NDVRKVCKSGSVELQSFFKVLKYSHIQHIESEVIGELRNNYSPYDAIEAAFPAGTLTGAPKYRAMEIIDEIEKSRRKAYG
GAVGYFSPNGCADTAITIRTAEMEKDGTIRLRVGGGIVADSEPENEYLETERKIAAVMRAFDIVKEYR

Sequences:

>Translated_468_residues
MTDKTTTNNITDENSKKQIIRKNFDFVEPLKLYGLLREEGINPFILESRDKHHSKARFTYISANPEFIVNIKNKTKIDNS
TYSNNSNPFQSLKEISDEMNVNIKNLDSKERFIGGFLGYFAYDCIHNYIGGDIEEPSVFGYYNSVFVYDHTYKRYYYLTH
NNSPEELKNAESIIKRAKNYEIEEEKDGGSNIAGCDASKEEHYNMVEKAKEYIYEGDAFQVVISKEFRVNSDYSPFKVYK
NLREINPSPYMFLLEFENKSLVGASPETMASVENNILQINPIAGSTKVGKTDEESKKLAELLLKDEKERAEHMMLVDLAR
NDVRKVCKSGSVELQSFFKVLKYSHIQHIESEVIGELRNNYSPYDAIEAAFPAGTLTGAPKYRAMEIIDEIEKSRRKAYG
GAVGYFSPNGCADTAITIRTAEMEKDGTIRLRVGGGIVADSEPENEYLETERKIAAVMRAFDIVKEYR
>Mature_467_residues
TDKTTTNNITDENSKKQIIRKNFDFVEPLKLYGLLREEGINPFILESRDKHHSKARFTYISANPEFIVNIKNKTKIDNST
YSNNSNPFQSLKEISDEMNVNIKNLDSKERFIGGFLGYFAYDCIHNYIGGDIEEPSVFGYYNSVFVYDHTYKRYYYLTHN
NSPEELKNAESIIKRAKNYEIEEEKDGGSNIAGCDASKEEHYNMVEKAKEYIYEGDAFQVVISKEFRVNSDYSPFKVYKN
LREINPSPYMFLLEFENKSLVGASPETMASVENNILQINPIAGSTKVGKTDEESKKLAELLLKDEKERAEHMMLVDLARN
DVRKVCKSGSVELQSFFKVLKYSHIQHIESEVIGELRNNYSPYDAIEAAFPAGTLTGAPKYRAMEIIDEIEKSRRKAYGG
AVGYFSPNGCADTAITIRTAEMEKDGTIRLRVGGGIVADSEPENEYLETERKIAAVMRAFDIVKEYR

Specific function: Catalyzes The Biosynthesis Of 4-Amino-4-Deoxychorismate (Adc) From Chorismate And Glutamine. [C]

COG id: COG0147

COG function: function code EH; Anthranilate/para-aminobenzoate synthases component I

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the anthranilate synthase component I family [H]

Homologues:

Organism=Escherichia coli, GI1788114, Length=433, Percent_Identity=30.4849884526559, Blast_Score=213, Evalue=2e-56,
Organism=Escherichia coli, GI1787518, Length=385, Percent_Identity=35.3246753246753, Blast_Score=204, Evalue=1e-53,
Organism=Escherichia coli, GI87082077, Length=274, Percent_Identity=24.0875912408759, Blast_Score=95, Evalue=1e-20,
Organism=Escherichia coli, GI1786809, Length=263, Percent_Identity=24.7148288973384, Blast_Score=89, Evalue=7e-19,
Organism=Saccharomyces cerevisiae, GI6320935, Length=457, Percent_Identity=33.0415754923414, Blast_Score=234, Evalue=3e-62,
Organism=Saccharomyces cerevisiae, GI6324361, Length=398, Percent_Identity=25.1256281407035, Blast_Score=111, Evalue=2e-25,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR005801
- InterPro:   IPR019999
- InterPro:   IPR006805
- InterPro:   IPR010116
- InterPro:   IPR015890 [H]

Pfam domain/function: PF04715 Anth_synt_I_N; PF00425 Chorismate_bind [H]

EC number: =4.1.3.27 [H]

Molecular weight: Translated: 53481; Mature: 53349

Theoretical pI: Translated: 5.35; Mature: 5.35

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.9 %Cys     (Translated Protein)
2.1 %Met     (Translated Protein)
3.0 %Cys+Met (Translated Protein)
0.9 %Cys     (Mature Protein)
1.9 %Met     (Mature Protein)
2.8 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MTDKTTTNNITDENSKKQIIRKNFDFVEPLKLYGLLREEGINPFILESRDKHHSKARFTY
CCCCCCCCCCCCCCHHHHHHHHCCCHHHHHHHHHHHHHCCCCEEEECCCCCCCCCEEEEE
ISANPEFIVNIKNKTKIDNSTYSNNSNPFQSLKEISDEMNVNIKNLDSKERFIGGFLGYF
EECCCCEEEEECCCCCCCCCCCCCCCCHHHHHHHHHHHHCCEEECCCHHHHHHHHHHHHH
AYDCIHNYIGGDIEEPSVFGYYNSVFVYDHTYKRYYYLTHNNSPEELKNAESIIKRAKNY
HHHHHHHHHCCCCCCCCEEEEECEEEEEEECEEEEEEEECCCCHHHHHHHHHHHHHHHCC
EIEEEKDGGSNIAGCDASKEEHYNMVEKAKEYIYEGDAFQVVISKEFRVNSDYSPFKVYK
CCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHCCCCEEEEEEEECEECCCCCCHHHHHH
NLREINPSPYMFLLEFENKSLVGASPETMASVENNILQINPIAGSTKVGKTDEESKKLAE
HHHHCCCCCEEEEEEECCCEEECCCHHHHHHHCCCEEEEECCCCCCCCCCCCHHHHHHHH
LLLKDEKERAEHMMLVDLARNDVRKVCKSGSVELQSFFKVLKYSHIQHIESEVIGELRNN
HHHHCHHHHHHHHHHHHHHHHHHHHHHHCCCEEHHHHHHHHHHHHHHHHHHHHHHHHHCC
YSPYDAIEAAFPAGTLTGAPKYRAMEIIDEIEKSRRKAYGGAVGYFSPNGCADTAITIRT
CCCHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHHHCCCEEECCCCCCCCCCEEEEEE
AEMEKDGTIRLRVGGGIVADSEPENEYLETERKIAAVMRAFDIVKEYR
EECCCCCEEEEEECCEEEECCCCCHHHHHHHHHHHHHHHHHHHHHHCC
>Mature Secondary Structure 
TDKTTTNNITDENSKKQIIRKNFDFVEPLKLYGLLREEGINPFILESRDKHHSKARFTY
CCCCCCCCCCCCCHHHHHHHHCCCHHHHHHHHHHHHHCCCCEEEECCCCCCCCCEEEEE
ISANPEFIVNIKNKTKIDNSTYSNNSNPFQSLKEISDEMNVNIKNLDSKERFIGGFLGYF
EECCCCEEEEECCCCCCCCCCCCCCCCHHHHHHHHHHHHCCEEECCCHHHHHHHHHHHHH
AYDCIHNYIGGDIEEPSVFGYYNSVFVYDHTYKRYYYLTHNNSPEELKNAESIIKRAKNY
HHHHHHHHHCCCCCCCCEEEEECEEEEEEECEEEEEEEECCCCHHHHHHHHHHHHHHHCC
EIEEEKDGGSNIAGCDASKEEHYNMVEKAKEYIYEGDAFQVVISKEFRVNSDYSPFKVYK
CCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHCCCCEEEEEEEECEECCCCCCHHHHHH
NLREINPSPYMFLLEFENKSLVGASPETMASVENNILQINPIAGSTKVGKTDEESKKLAE
HHHHCCCCCEEEEEEECCCEEECCCHHHHHHHCCCEEEEECCCCCCCCCCCCHHHHHHHH
LLLKDEKERAEHMMLVDLARNDVRKVCKSGSVELQSFFKVLKYSHIQHIESEVIGELRNN
HHHHCHHHHHHHHHHHHHHHHHHHHHHHCCCEEHHHHHHHHHHHHHHHHHHHHHHHHHCC
YSPYDAIEAAFPAGTLTGAPKYRAMEIIDEIEKSRRKAYGGAVGYFSPNGCADTAITIRT
CCCHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHHHCCCEEECCCCCCCCCCEEEEEE
AEMEKDGTIRLRVGGGIVADSEPENEYLETERKIAAVMRAFDIVKEYR
EECCCCCEEEEEECCEEEECCCCCHHHHHHHHHHHHHHHHHHHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 10628865 [H]