| Definition | Legionella pneumophila str. Lens, complete genome. |
|---|---|
| Accession | NC_006369 |
| Length | 3,345,687 |
Click here to switch to the map view.
The map label for this gene is trpE [H]
Identifier: 54294622
GI number: 54294622
Start: 1894594
End: 1896750
Strand: Reverse
Name: trpE [H]
Synonym: lpl1698
Alternate gene names: 54294622
Gene position: 1896750-1894594 (Counterclockwise)
Preceding gene: 54294630
Following gene: 54294621
Centisome position: 56.69
GC content: 38.2
Gene sequence:
>2157_bases ATGGTATTCATGTTACAGCAATATAAAACTCTTGGTGGTGTTCATGTTGAGTTTTCTCAACAAGAGTTGGATTATCAACA AGGCATAGATTTTTTGCTTGAGAGCCTTGACTCTCAACGTGGCGCAGTATTTGCTTCGAGCTTTGAATATCCGGGACGCT ATACTTGTTGGGACATGGGTTTTTATAATCCCCCATTAGTTATGATCTGTCAAAGCAATACCATCTGTTTTGAGGCATTA AATCAACGAGGCGAGATATTATTATCTTTTCTCTATCCGTTATTAAAAACAACAGATCTCTGGGAGGTAATTAGCCAAAG GACCTCATTTTGTCAGTTAAAAATTAAATCTTCAGACAAAGTATTTAGTGAGGAGGAGCGGAGCCATCAACCATCAGTAT TCAGCGCAATTCGCCTCTTATTGAATTTTTTTAAAACAGAAGAAGATTCATACTTGGGTTTATATGGTGCTTTTGGGTTT GATCTGATTTATCAATTTGAACAGTTGGAGCAGTGTAAACCAAGAAATGAAACACAGAGAGATATGGTTCTCTATCTACC TGATGAAATTTATATAGTGAATCATCGTAAGGAAGAAGCCTTTGTTAGACGCTATGATTTTCAATATCAGGGGCGATCAA CTCAATCTTTATCCAGAGAAGGAAAGTATTCACCATATCAACCTATCCACAAACCGGAAAAAAACTGTGATCACGAGCCA GGTGAATATGCTGAAGTGGTTAAAAAAGCTAAAGAAAAATTTTCCTGTGGTGATTTATTTGAAGTGGTTCCTAGCCAAAC TTTCTATACTCACTTTGCTGAAAAGCCGTCAATATTATTTCGCCAAATGCGAGAAATAAATCCATCGCCATATGGATTTT TTGTTAATTTGGGTGACGAAGAATATCTGGTAGGTGCTTCACCTGAAATGTATGTTCGTGTTCAAGGTAAAAGAGTAGAA ACTTGCCCTATCTCAGGCACTATCAAACGGGGAGCAGATGCTATTGAGGATGCTCACAATATTCAGACACTTCTAGATTC AGAGAAAGAAGAATCAGAACTAACCATGTGTACCGATGTGGATAGAAATGATAAGTCAAGGATATGCGAAGCAGGGAGTG TGAAAGTCATTGGGCGTCGCCAAATTGAAATGTATTCTCGATTGATTCATACAGTTGATCATGTTGAGGGTGTTTTAAGA GATGGATTTGATGCAGTAGATGCTTTTTTAACTCATATGTGGGTTGTTACTGTGACTGGTGCGCCTAAAATTTGGGCTAT GAACTTCATTGAACAACATGAGAAATCCCCGCGTAAATGGTATGCAGGGGCCGTAGGATGGTTTGGTTTTGATGGAAATT TAAATACTGGATTGGTCTTAAGAACAGTGCGAATAGAAAAGGGAACTGCAGAAATTAGAGTAGGCGCAACGTTACTTTAT GACTCTATTCCTGAAGCTGAGGAAGAGGAGACGAGATTAAAGGCTTCTGCATTTTTAGACATTTTACAAAAACCATGGCA AACAGCAAAAAAGAAGACAGAGAATATCCCCCTGGTAGGGGAAAATAAAAAAGTTTTACTTATCGATCATCAAGATTCCT TTGTTCATACTTTGGCAAACTATTTAAGACAAACGGGAGCTGCGGTTACAACAGTTCGTTATGACAAGGCGATTGGCTAT TTACAAAATAATCATTTTGATTTGATCGTATTATCACCTGGCCCTGGAAAACCGGTTGATTTTAAGCTTTCAGAAACAAT TGATATGATACTCTCAAAGAACATACCAATATTCGGTGTTTGTCTGGGGCTGCAAGGAATTGTTGAATATTTTGGAGGGG TTTTGGATGTTCTTGATTACCCTATGCATGGAAAATCTTCAGTAATCAGGGTATTGGATAACAAGGGGTTGTTCTCCGGT TTAGGTGATTGTTTTAAAGCGGGAAGATACCATTCACTCTATGCCAGAGCGGAGGCTTTACCCAATGAATTATTAGTTAC CGCTGTAAGTGAAGATGATGTGATTATGGCAGTTTCTCATAAGCATTTACCTGTGCATGCGGTTCAATTTCATCCAGAGA CAATTTTGTCTTTATCGGATCAAGTGGGTTTAAGAATAATCATCAATTTGATGAACATGGTGAAGGACAATGGGTAA
Upstream 100 bases:
>100_bases TGAAGACATAAAAAAGCAATGATATTGAAATGTTACAAGATTCTTGCAGAACAGTGGTTTTACAGTAGAATGAATATTTG TACGAATTAAATGATAGAGA
Downstream 100 bases:
>100_bases AAAAATACTGATTTTATATTTTGTATCAGTTCTATTAGGGATATTAACAGGCGCAATTGCTTCATTATTGCAACTTACTA TTCAACAGATGGATCATCTG
Product: anthranilate synthase
Products: NA
Alternate protein names: Glutamine amidotransferase [H]
Number of amino acids: Translated: 718; Mature: 718
Protein sequence:
>718_residues MVFMLQQYKTLGGVHVEFSQQELDYQQGIDFLLESLDSQRGAVFASSFEYPGRYTCWDMGFYNPPLVMICQSNTICFEAL NQRGEILLSFLYPLLKTTDLWEVISQRTSFCQLKIKSSDKVFSEEERSHQPSVFSAIRLLLNFFKTEEDSYLGLYGAFGF DLIYQFEQLEQCKPRNETQRDMVLYLPDEIYIVNHRKEEAFVRRYDFQYQGRSTQSLSREGKYSPYQPIHKPEKNCDHEP GEYAEVVKKAKEKFSCGDLFEVVPSQTFYTHFAEKPSILFRQMREINPSPYGFFVNLGDEEYLVGASPEMYVRVQGKRVE TCPISGTIKRGADAIEDAHNIQTLLDSEKEESELTMCTDVDRNDKSRICEAGSVKVIGRRQIEMYSRLIHTVDHVEGVLR DGFDAVDAFLTHMWVVTVTGAPKIWAMNFIEQHEKSPRKWYAGAVGWFGFDGNLNTGLVLRTVRIEKGTAEIRVGATLLY DSIPEAEEEETRLKASAFLDILQKPWQTAKKKTENIPLVGENKKVLLIDHQDSFVHTLANYLRQTGAAVTTVRYDKAIGY LQNNHFDLIVLSPGPGKPVDFKLSETIDMILSKNIPIFGVCLGLQGIVEYFGGVLDVLDYPMHGKSSVIRVLDNKGLFSG LGDCFKAGRYHSLYARAEALPNELLVTAVSEDDVIMAVSHKHLPVHAVQFHPETILSLSDQVGLRIIINLMNMVKDNG
Sequences:
>Translated_718_residues MVFMLQQYKTLGGVHVEFSQQELDYQQGIDFLLESLDSQRGAVFASSFEYPGRYTCWDMGFYNPPLVMICQSNTICFEAL NQRGEILLSFLYPLLKTTDLWEVISQRTSFCQLKIKSSDKVFSEEERSHQPSVFSAIRLLLNFFKTEEDSYLGLYGAFGF DLIYQFEQLEQCKPRNETQRDMVLYLPDEIYIVNHRKEEAFVRRYDFQYQGRSTQSLSREGKYSPYQPIHKPEKNCDHEP GEYAEVVKKAKEKFSCGDLFEVVPSQTFYTHFAEKPSILFRQMREINPSPYGFFVNLGDEEYLVGASPEMYVRVQGKRVE TCPISGTIKRGADAIEDAHNIQTLLDSEKEESELTMCTDVDRNDKSRICEAGSVKVIGRRQIEMYSRLIHTVDHVEGVLR DGFDAVDAFLTHMWVVTVTGAPKIWAMNFIEQHEKSPRKWYAGAVGWFGFDGNLNTGLVLRTVRIEKGTAEIRVGATLLY DSIPEAEEEETRLKASAFLDILQKPWQTAKKKTENIPLVGENKKVLLIDHQDSFVHTLANYLRQTGAAVTTVRYDKAIGY LQNNHFDLIVLSPGPGKPVDFKLSETIDMILSKNIPIFGVCLGLQGIVEYFGGVLDVLDYPMHGKSSVIRVLDNKGLFSG LGDCFKAGRYHSLYARAEALPNELLVTAVSEDDVIMAVSHKHLPVHAVQFHPETILSLSDQVGLRIIINLMNMVKDNG >Mature_718_residues MVFMLQQYKTLGGVHVEFSQQELDYQQGIDFLLESLDSQRGAVFASSFEYPGRYTCWDMGFYNPPLVMICQSNTICFEAL NQRGEILLSFLYPLLKTTDLWEVISQRTSFCQLKIKSSDKVFSEEERSHQPSVFSAIRLLLNFFKTEEDSYLGLYGAFGF DLIYQFEQLEQCKPRNETQRDMVLYLPDEIYIVNHRKEEAFVRRYDFQYQGRSTQSLSREGKYSPYQPIHKPEKNCDHEP GEYAEVVKKAKEKFSCGDLFEVVPSQTFYTHFAEKPSILFRQMREINPSPYGFFVNLGDEEYLVGASPEMYVRVQGKRVE TCPISGTIKRGADAIEDAHNIQTLLDSEKEESELTMCTDVDRNDKSRICEAGSVKVIGRRQIEMYSRLIHTVDHVEGVLR DGFDAVDAFLTHMWVVTVTGAPKIWAMNFIEQHEKSPRKWYAGAVGWFGFDGNLNTGLVLRTVRIEKGTAEIRVGATLLY DSIPEAEEEETRLKASAFLDILQKPWQTAKKKTENIPLVGENKKVLLIDHQDSFVHTLANYLRQTGAAVTTVRYDKAIGY LQNNHFDLIVLSPGPGKPVDFKLSETIDMILSKNIPIFGVCLGLQGIVEYFGGVLDVLDYPMHGKSSVIRVLDNKGLFSG LGDCFKAGRYHSLYARAEALPNELLVTAVSEDDVIMAVSHKHLPVHAVQFHPETILSLSDQVGLRIIINLMNMVKDNG
Specific function: Tryptophan biosynthesis; first step. [C]
COG id: COG0147
COG function: function code EH; Anthranilate/para-aminobenzoate synthases component I
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 1 glutamine amidotransferase type-1 domain [H]
Homologues:
Organism=Escherichia coli, GI1787518, Length=421, Percent_Identity=32.541567695962, Blast_Score=196, Evalue=4e-51, Organism=Escherichia coli, GI1788114, Length=352, Percent_Identity=27.5568181818182, Blast_Score=144, Evalue=1e-35, Organism=Escherichia coli, GI1789760, Length=189, Percent_Identity=36.5079365079365, Blast_Score=108, Evalue=1e-24, Organism=Escherichia coli, GI1787517, Length=177, Percent_Identity=36.1581920903955, Blast_Score=97, Evalue=3e-21, Organism=Escherichia coli, GI1786809, Length=304, Percent_Identity=26.6447368421053, Blast_Score=87, Evalue=5e-18, Organism=Escherichia coli, GI87082077, Length=288, Percent_Identity=23.2638888888889, Blast_Score=74, Evalue=4e-14, Organism=Saccharomyces cerevisiae, GI6320935, Length=277, Percent_Identity=36.4620938628159, Blast_Score=152, Evalue=1e-37, Organism=Saccharomyces cerevisiae, GI6322638, Length=191, Percent_Identity=38.7434554973822, Blast_Score=126, Evalue=1e-29, Organism=Saccharomyces cerevisiae, GI6324361, Length=125, Percent_Identity=33.6, Blast_Score=70, Evalue=1e-12,
Paralogues:
None
Copy number: 700 Molecules/Cell In: Glucose minimal media [C]
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR005801 - InterPro: IPR006805 - InterPro: IPR006220 - InterPro: IPR010112 - InterPro: IPR001317 - InterPro: IPR015890 - InterPro: IPR011702 - InterPro: IPR017926 - InterPro: IPR000991 - InterPro: IPR006221 [H]
Pfam domain/function: PF04715 Anth_synt_I_N; PF00425 Chorismate_bind; PF00117 GATase [H]
EC number: =4.1.3.27 [H]
Molecular weight: Translated: 81712; Mature: 81712
Theoretical pI: Translated: 5.53; Mature: 5.53
Prosite motif: PS00442 GATASE_TYPE_I
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.7 %Cys (Translated Protein) 2.2 %Met (Translated Protein) 3.9 %Cys+Met (Translated Protein) 1.7 %Cys (Mature Protein) 2.2 %Met (Mature Protein) 3.9 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MVFMLQQYKTLGGVHVEFSQQELDYQQGIDFLLESLDSQRGAVFASSFEYPGRYTCWDMG CEEEEEHHHHHCCEEEEECHHHCCHHHHHHHHHHHHCCCCCEEEEECCCCCCCEEEEECC FYNPPLVMICQSNTICFEALNQRGEILLSFLYPLLKTTDLWEVISQRTSFCQLKIKSSDK CCCCCEEEEECCCCHHHHHHCCHHHHHHHHHHHHHCCCHHHHHHHCCCCEEEEEECCCCC VFSEEERSHQPSVFSAIRLLLNFFKTEEDSYLGLYGAFGFDLIYQFEQLEQCKPRNETQR CCCHHHHCCCCHHHHHHHHHHHHHHCCCCCEEEEHHHHHHHHHHHHHHHHHCCCCCCCCC DMVLYLPDEIYIVNHRKEEAFVRRYDFQYQGRSTQSLSREGKYSPYQPIHKPEKNCDHEP CEEEEECCEEEEEECCHHHHHHHHHCCEECCCCHHHHHCCCCCCCCCCCCCCCCCCCCCC GEYAEVVKKAKEKFSCGDLFEVVPSQTFYTHFAEKPSILFRQMREINPSPYGFFVNLGDE CHHHHHHHHHHHHCCCCHHHHHCCCCHHHHHHCCCHHHHHHHHHHCCCCCCEEEEEECCC EYLVGASPEMYVRVQGKRVETCPISGTIKRGADAIEDAHNIQTLLDSEKEESELTMCTDV CEEECCCCCEEEEEECCEEEECCCCCCHHHCCHHHHHHHHHHHHHCCCCCCCCEEEEECC DRNDKSRICEAGSVKVIGRRQIEMYSRLIHTVDHVEGVLRDGFDAVDAFLTHMWVVTVTG CCCCHHHHCCCCCEEEECHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHEEEEEECC APKIWAMNFIEQHEKSPRKWYAGAVGWFGFDGNLNTGLVLRTVRIEKGTAEIRVGATLLY CCCHHHHHHHHHHCCCCCHHCCCCCEEEECCCCCCCCEEEEEEEEECCCCEEEECEEEEE DSIPEAEEEETRLKASAFLDILQKPWQTAKKKTENIPLVGENKKVLLIDHQDSFVHTLAN CCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCEECCCCEEEEEECCCHHHHHHHH YLRQTGAAVTTVRYDKAIGYLQNNHFDLIVLSPGPGKPVDFKLSETIDMILSKNIPIFGV HHHHCCCEEEEEEHHHHHHHEECCCEEEEEECCCCCCCCCEEHHHHHHHHHHCCCCEEEH CLGLQGIVEYFGGVLDVLDYPMHGKSSVIRVLDNKGLFSGLGDCFKAGRYHSLYARAEAL HHHHHHHHHHHHHHHHHHCCCCCCCCCEEEEECCCCHHHHHHHHHHCCCHHHHHHHHHHC PNELLVTAVSEDDVIMAVSHKHLPVHAVQFHPETILSLSDQVGLRIIINLMNMVKDNG CCEEEEEEECCCCEEEEEECCCCCEEEEEECCHHHHHCCHHHHHHHHHHHHHHHHCCC >Mature Secondary Structure MVFMLQQYKTLGGVHVEFSQQELDYQQGIDFLLESLDSQRGAVFASSFEYPGRYTCWDMG CEEEEEHHHHHCCEEEEECHHHCCHHHHHHHHHHHHCCCCCEEEEECCCCCCCEEEEECC FYNPPLVMICQSNTICFEALNQRGEILLSFLYPLLKTTDLWEVISQRTSFCQLKIKSSDK CCCCCEEEEECCCCHHHHHHCCHHHHHHHHHHHHHCCCHHHHHHHCCCCEEEEEECCCCC VFSEEERSHQPSVFSAIRLLLNFFKTEEDSYLGLYGAFGFDLIYQFEQLEQCKPRNETQR CCCHHHHCCCCHHHHHHHHHHHHHHCCCCCEEEEHHHHHHHHHHHHHHHHHCCCCCCCCC DMVLYLPDEIYIVNHRKEEAFVRRYDFQYQGRSTQSLSREGKYSPYQPIHKPEKNCDHEP CEEEEECCEEEEEECCHHHHHHHHHCCEECCCCHHHHHCCCCCCCCCCCCCCCCCCCCCC GEYAEVVKKAKEKFSCGDLFEVVPSQTFYTHFAEKPSILFRQMREINPSPYGFFVNLGDE CHHHHHHHHHHHHCCCCHHHHHCCCCHHHHHHCCCHHHHHHHHHHCCCCCCEEEEEECCC EYLVGASPEMYVRVQGKRVETCPISGTIKRGADAIEDAHNIQTLLDSEKEESELTMCTDV CEEECCCCCEEEEEECCEEEECCCCCCHHHCCHHHHHHHHHHHHHCCCCCCCCEEEEECC DRNDKSRICEAGSVKVIGRRQIEMYSRLIHTVDHVEGVLRDGFDAVDAFLTHMWVVTVTG CCCCHHHHCCCCCEEEECHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHEEEEEECC APKIWAMNFIEQHEKSPRKWYAGAVGWFGFDGNLNTGLVLRTVRIEKGTAEIRVGATLLY CCCHHHHHHHHHHCCCCCHHCCCCCEEEECCCCCCCCEEEEEEEEECCCCEEEECEEEEE DSIPEAEEEETRLKASAFLDILQKPWQTAKKKTENIPLVGENKKVLLIDHQDSFVHTLAN CCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCEECCCCEEEEEECCCHHHHHHHH YLRQTGAAVTTVRYDKAIGYLQNNHFDLIVLSPGPGKPVDFKLSETIDMILSKNIPIFGV HHHHCCCEEEEEEHHHHHHHEECCCEEEEEECCCCCCCCCEEHHHHHHHHHHCCCCEEEH CLGLQGIVEYFGGVLDVLDYPMHGKSSVIRVLDNKGLFSGLGDCFKAGRYHSLYARAEAL HHHHHHHHHHHHHHHHHHCCCCCCCCCEEEEECCCCHHHHHHHHHHCCCHHHHHHHHHHC PNELLVTAVSEDDVIMAVSHKHLPVHAVQFHPETILSLSDQVGLRIIINLMNMVKDNG CCEEEEEEECCCCEEEEEECCCCCEEEEEECCHHHHHCCHHHHHHHHHHHHHHHHCCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 2656657; 11481430 [H]