| Definition | Rhodopseudomonas palustris HaA2, complete genome. |
|---|---|
| Accession | NC_007778 |
| Length | 5,331,656 |
Click here to switch to the map view.
The map label for this gene is trpE(G) [H]
Identifier: 86751420
GI number: 86751420
Start: 4901468
End: 4903630
Strand: Reverse
Name: trpE(G) [H]
Synonym: RPB_4318
Alternate gene names: 86751420
Gene position: 4903630-4901468 (Counterclockwise)
Preceding gene: 86751423
Following gene: 86751419
Centisome position: 91.97
GC content: 67.73
Gene sequence:
>2163_bases ATGAACAGGACCGTTTTCTCGCTTCCCGCGCAGAGCGACTACAAGACCGCCGCGGGCCTCGCCGTGTCGCGCACGGTGGC GGCCTTCACCGGCGGCAGGGCGCTCGATGATCTGATCGACCTTCTGGACCGCCGCCGCGGCGTGATGCTGTCGTCCGGCA CTACGGTGCCCGGGCGCTACGAGAGCTTCGATTTCGGCTTCGCCGATCCGCCGCTGGCGCTGACCATCCGCGCCGAGCAG TTTTCGATCGAGGCGCTCAATCCGCGCGGCCATGTGCTGGTCGCGTTCCTGTCCGACAGGCTCGACGAGCCCTGCGTGGT GGTCGAGCAGGCCTGCGCGACGAAGATCAGGGGCCACATCGTTCGCGGCGAGGCGCCGGTCGATGAGGAGCAGCGCACCC GCCGCGCCAGCGCGATCTCGCTGGTGCGCGCGCTGGTGGCGGCGTTCGCCTCACCGGCGGACCCGATGCTCGGCCTGTAC GGCGCCTTCGCCTACGATCTGGTGTTCCAGTTCGAGGATCTGGCGCAGAAGCGCGCGCGCGAGGCCGACCAGCGCGACAT CGTGCTGTATGTGCCGGATCGGCTGTTGGCCTATGACCGCGCCACCGGCCGCGGCGTCAATATCGCCTATGAATTCGCCT GGAAGGGCAAATCCACCCAGGGCCTGCCCAACGACACCGCCGAGAGCGCCTACACCCAGACCGGCCGGCAGGGCTTCGCC GACCACGCGCCGGGCGAATACGCCAAAGTCGTCGAGGTCGCCCGCGAGCATTTCGCCCGCGGCGATCTGTTCGAGGCGGT GCCCGGGCAGTTGTTCGGCGAACCCTGCGAGCGCTCGCCGGCCGAAGTGTTCAAGCGGCTGTGCCGGATCAATCCGTCGC CCTATGGCGGGTTGCTCAATCTCGGCGACGGCGAATTCCTGGTGTCGGCCTCGCCGGAGATGTTCGTCCGCTCCGACGGC CGCCGGATCGAGACCTGCCCGATCTCCGGCACCATCGCCCGCGGCGTCGACGCCATTGCGGATGCCGAGCAGATCCAGAA GCTTTTGAACTCCGAGAAGGACGAGTTCGAGCTCAACATGTGCACCGACGTCGACCGCAACGACAAGGCGCGGGTCTGCG TGCCGGGCACCATCAAGGTGCTGGCGCGGCGCCAGATCGAGACCTATTCGAAGCTGTTCCACACGGTGGACCACGTCGAG GGCATGCTCCGCCCCGGCTTCGACGCGCTCGATGCCTTCCTCACCCACGCCTGGGCGGTGACGGTGACCGGCGCGCCGAA ACTCTGGGCGATGCAGTTCGTCGAGGATCACGAGCGCTCGCCGCGGCGCTGGTATGCCGGCGCGTTCGGCGTCGTCGGCT TCGACGGCTCGATCAACACCGGCCTCACCATCCGTACCATCCGGATGAAGGACGGCCTCGCCGAAGTCCGCGTCGGGGCG ACTTGTCTGTTCGATAGCGACCCGGTCGCCGAGGACAAGGAGTGCCAGGTGAAAGCCGCCGCGCTGTTCCAGGCGCTGCG CGGCGATCCGCCGAAGCCGCTGTCGGCGGTGGCACCGGATGCCACCGGCTCCGGCAAGCGCGTGCTGCTGGTCGATCACG ACGACAGCTTCGTGCACATGCTGGCGGACTATTTCCGCCAGGTCGGCGCCCAGGTCAGCGTGGTGCGCCACATCCACGCG CAGAAGATGCTGGCCGAGAATGCCTATGATCTGCTGGTGCTGTCGCCCGGCCCGGGCCGGCCGGCGGATTTCAAGATTGC GTTGACGATCGACACCGCTCTGGCGAAGCAACTGCCGATCTTCGGGGTCTGCCTCGGCGTGCAGGCGATGGGCGAATATT TCGGCGGTACGCTCGGCCAGCTTAAGCAGCCGGCGCATGGCCGGCCGTCGCGGATCCAGGTGCGCGGCGGCACGCTGATG CACGGCCTGCCGAACGAGATCACCATCGGTCGCTATCATTCACTCTATGTCGACATGCAGGACATGCCGGATGCGCTCGA CGTCACCGCCTCGACCGAGGACGGCATCGCGATGGCGATCGAGCACAAGACGCTGCCGGTCGGCGGCGTCCAATTCCACC CGGAATCGCTGATGTCGCTCGGCGGCGAGGTCGGGCTGCGGATCGTCGAAAACGCCTTCCGGCTGGGCCGGCCGATGGCC TGA
Upstream 100 bases:
>100_bases GATTTTCCGTTTTTTGAATCGTCCCGAGGCCGCCCCACAGTGGCGGCCTTTCGTTTGTCCTGTGTGGCGTTCCTCCGGCA AGTTGAGATAAGAGGATGCC
Downstream 100 bases:
>100_bases TCCTGAAATTGATCGAAACACGTGTGTCGTCGGGAGTGGGCTGCTAACACGCCCCGGCGGCAGTTATCCGAATTACCGGA TTGCCTCCGACGCCCCGCAA
Product: anthranilate synthase
Products: NA
Alternate protein names: Glutamine amidotransferase [H]
Number of amino acids: Translated: 720; Mature: 720
Protein sequence:
>720_residues MNRTVFSLPAQSDYKTAAGLAVSRTVAAFTGGRALDDLIDLLDRRRGVMLSSGTTVPGRYESFDFGFADPPLALTIRAEQ FSIEALNPRGHVLVAFLSDRLDEPCVVVEQACATKIRGHIVRGEAPVDEEQRTRRASAISLVRALVAAFASPADPMLGLY GAFAYDLVFQFEDLAQKRAREADQRDIVLYVPDRLLAYDRATGRGVNIAYEFAWKGKSTQGLPNDTAESAYTQTGRQGFA DHAPGEYAKVVEVAREHFARGDLFEAVPGQLFGEPCERSPAEVFKRLCRINPSPYGGLLNLGDGEFLVSASPEMFVRSDG RRIETCPISGTIARGVDAIADAEQIQKLLNSEKDEFELNMCTDVDRNDKARVCVPGTIKVLARRQIETYSKLFHTVDHVE GMLRPGFDALDAFLTHAWAVTVTGAPKLWAMQFVEDHERSPRRWYAGAFGVVGFDGSINTGLTIRTIRMKDGLAEVRVGA TCLFDSDPVAEDKECQVKAAALFQALRGDPPKPLSAVAPDATGSGKRVLLVDHDDSFVHMLADYFRQVGAQVSVVRHIHA QKMLAENAYDLLVLSPGPGRPADFKIALTIDTALAKQLPIFGVCLGVQAMGEYFGGTLGQLKQPAHGRPSRIQVRGGTLM HGLPNEITIGRYHSLYVDMQDMPDALDVTASTEDGIAMAIEHKTLPVGGVQFHPESLMSLGGEVGLRIVENAFRLGRPMA
Sequences:
>Translated_720_residues MNRTVFSLPAQSDYKTAAGLAVSRTVAAFTGGRALDDLIDLLDRRRGVMLSSGTTVPGRYESFDFGFADPPLALTIRAEQ FSIEALNPRGHVLVAFLSDRLDEPCVVVEQACATKIRGHIVRGEAPVDEEQRTRRASAISLVRALVAAFASPADPMLGLY GAFAYDLVFQFEDLAQKRAREADQRDIVLYVPDRLLAYDRATGRGVNIAYEFAWKGKSTQGLPNDTAESAYTQTGRQGFA DHAPGEYAKVVEVAREHFARGDLFEAVPGQLFGEPCERSPAEVFKRLCRINPSPYGGLLNLGDGEFLVSASPEMFVRSDG RRIETCPISGTIARGVDAIADAEQIQKLLNSEKDEFELNMCTDVDRNDKARVCVPGTIKVLARRQIETYSKLFHTVDHVE GMLRPGFDALDAFLTHAWAVTVTGAPKLWAMQFVEDHERSPRRWYAGAFGVVGFDGSINTGLTIRTIRMKDGLAEVRVGA TCLFDSDPVAEDKECQVKAAALFQALRGDPPKPLSAVAPDATGSGKRVLLVDHDDSFVHMLADYFRQVGAQVSVVRHIHA QKMLAENAYDLLVLSPGPGRPADFKIALTIDTALAKQLPIFGVCLGVQAMGEYFGGTLGQLKQPAHGRPSRIQVRGGTLM HGLPNEITIGRYHSLYVDMQDMPDALDVTASTEDGIAMAIEHKTLPVGGVQFHPESLMSLGGEVGLRIVENAFRLGRPMA >Mature_720_residues MNRTVFSLPAQSDYKTAAGLAVSRTVAAFTGGRALDDLIDLLDRRRGVMLSSGTTVPGRYESFDFGFADPPLALTIRAEQ FSIEALNPRGHVLVAFLSDRLDEPCVVVEQACATKIRGHIVRGEAPVDEEQRTRRASAISLVRALVAAFASPADPMLGLY GAFAYDLVFQFEDLAQKRAREADQRDIVLYVPDRLLAYDRATGRGVNIAYEFAWKGKSTQGLPNDTAESAYTQTGRQGFA DHAPGEYAKVVEVAREHFARGDLFEAVPGQLFGEPCERSPAEVFKRLCRINPSPYGGLLNLGDGEFLVSASPEMFVRSDG RRIETCPISGTIARGVDAIADAEQIQKLLNSEKDEFELNMCTDVDRNDKARVCVPGTIKVLARRQIETYSKLFHTVDHVE GMLRPGFDALDAFLTHAWAVTVTGAPKLWAMQFVEDHERSPRRWYAGAFGVVGFDGSINTGLTIRTIRMKDGLAEVRVGA TCLFDSDPVAEDKECQVKAAALFQALRGDPPKPLSAVAPDATGSGKRVLLVDHDDSFVHMLADYFRQVGAQVSVVRHIHA QKMLAENAYDLLVLSPGPGRPADFKIALTIDTALAKQLPIFGVCLGVQAMGEYFGGTLGQLKQPAHGRPSRIQVRGGTLM HGLPNEITIGRYHSLYVDMQDMPDALDVTASTEDGIAMAIEHKTLPVGGVQFHPESLMSLGGEVGLRIVENAFRLGRPMA
Specific function: Tryptophan biosynthesis; first step. [C]
COG id: COG0147
COG function: function code EH; Anthranilate/para-aminobenzoate synthases component I
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 1 glutamine amidotransferase type-1 domain [H]
Homologues:
Organism=Escherichia coli, GI1787518, Length=409, Percent_Identity=31.2958435207824, Blast_Score=159, Evalue=4e-40, Organism=Escherichia coli, GI1788114, Length=354, Percent_Identity=28.8135593220339, Blast_Score=124, Evalue=2e-29, Organism=Escherichia coli, GI1789760, Length=178, Percent_Identity=41.0112359550562, Blast_Score=122, Evalue=7e-29, Organism=Escherichia coli, GI1787517, Length=179, Percent_Identity=40.2234636871508, Blast_Score=119, Evalue=7e-28, Organism=Escherichia coli, GI1786809, Length=229, Percent_Identity=28.3842794759825, Blast_Score=87, Evalue=4e-18, Organism=Saccharomyces cerevisiae, GI6320935, Length=280, Percent_Identity=34.6428571428571, Blast_Score=156, Evalue=1e-38, Organism=Saccharomyces cerevisiae, GI6322638, Length=190, Percent_Identity=38.9473684210526, Blast_Score=132, Evalue=2e-31, Organism=Saccharomyces cerevisiae, GI6324361, Length=126, Percent_Identity=34.9206349206349, Blast_Score=69, Evalue=4e-12,
Paralogues:
None
Copy number: 700 Molecules/Cell In: Glucose minimal media [C]
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR005801 - InterPro: IPR006805 - InterPro: IPR006220 - InterPro: IPR010112 - InterPro: IPR015890 - InterPro: IPR011702 - InterPro: IPR017926 - InterPro: IPR000991 - InterPro: IPR006221 [H]
Pfam domain/function: PF04715 Anth_synt_I_N; PF00425 Chorismate_bind; PF00117 GATase [H]
EC number: =4.1.3.27 [H]
Molecular weight: Translated: 78506; Mature: 78506
Theoretical pI: Translated: 5.98; Mature: 5.98
Prosite motif: PS00442 GATASE_TYPE_I
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.4 %Cys (Translated Protein) 2.4 %Met (Translated Protein) 3.8 %Cys+Met (Translated Protein) 1.4 %Cys (Mature Protein) 2.4 %Met (Mature Protein) 3.8 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MNRTVFSLPAQSDYKTAAGLAVSRTVAAFTGGRALDDLIDLLDRRRGVMLSSGTTVPGRY CCCCEEECCCCCCCHHHHCHHHHHHHHHHCCCHHHHHHHHHHHHCCCEEEECCCCCCCCC ESFDFGFADPPLALTIRAEQFSIEALNPRGHVLVAFLSDRLDEPCVVVEQACATKIRGHI CCCCCCCCCCCEEEEEEECEEEEEEECCCCCEEEEEEHHCCCCCHHHHHHHHHHHHHCEE VRGEAPVDEEQRTRRASAISLVRALVAAFASPADPMLGLYGAFAYDLVFQFEDLAQKRAR EECCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHH EADQRDIVLYVPDRLLAYDRATGRGVNIAYEFAWKGKSTQGLPNDTAESAYTQTGRQGFA CCCCCCEEEEECCHHHHHCCCCCCCCEEEEEEEECCCCCCCCCCCHHHHHHHHCCCCCCC DHAPGEYAKVVEVAREHFARGDLFEAVPGQLFGEPCERSPAEVFKRLCRINPSPYGGLLN CCCCCHHHHHHHHHHHHHCCCCHHHHCCHHHCCCCCCCCHHHHHHHHHCCCCCCCCCEEE LGDGEFLVSASPEMFVRSDGRRIETCPISGTIARGVDAIADAEQIQKLLNSEKDEFELNM CCCCCEEEECCCCEEEECCCCEEEECCCCCHHHHHHHHHCCHHHHHHHHCCCCCCEEEEE CTDVDRNDKARVCVPGTIKVLARRQIETYSKLFHTVDHVEGMLRPGFDALDAFLTHAWAV ECCCCCCCCCEEEECHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHCEEEE TVTGAPKLWAMQFVEDHERSPRRWYAGAFGVVGFDGSINTGLTIRTIRMKDGLAEVRVGA EECCCCHHHHHHHHHHHCCCCCCEECCCCEEEEECCCCCCCEEEEEEEECCCHHHHEECE TCLFDSDPVAEDKECQVKAAALFQALRGDPPKPLSAVAPDATGSGKRVLLVDHDDSFVHM EEEECCCCCCCCCHHHHHHHHHHHHHCCCCCCCCHHCCCCCCCCCCEEEEEECCCHHHHH LADYFRQVGAQVSVVRHIHAQKMLAENAYDLLVLSPGPGRPADFKIALTIDTALAKQLPI HHHHHHHHCCHHHHHHHHHHHHHHHCCCCEEEEECCCCCCCCCEEEEEEECHHHHHHCCH FGVCLGVQAMGEYFGGTLGQLKQPAHGRPSRIQVRGGTLMHGLPNEITIGRYHSLYVDMQ HHHHHHHHHHHHHHCCCHHHHCCCCCCCCCEEEEECCEEECCCCCCEEEEEEEEEEEEHH DMPDALDVTASTEDGIAMAIEHKTLPVGGVQFHPESLMSLGGEVGLRIVENAFRLGRPMA HCCCCCEEECCCCCCEEEEEECCCCCCCCEEECHHHHHHCCHHHHHHHHHHHHHCCCCCC >Mature Secondary Structure MNRTVFSLPAQSDYKTAAGLAVSRTVAAFTGGRALDDLIDLLDRRRGVMLSSGTTVPGRY CCCCEEECCCCCCCHHHHCHHHHHHHHHHCCCHHHHHHHHHHHHCCCEEEECCCCCCCCC ESFDFGFADPPLALTIRAEQFSIEALNPRGHVLVAFLSDRLDEPCVVVEQACATKIRGHI CCCCCCCCCCCEEEEEEECEEEEEEECCCCCEEEEEEHHCCCCCHHHHHHHHHHHHHCEE VRGEAPVDEEQRTRRASAISLVRALVAAFASPADPMLGLYGAFAYDLVFQFEDLAQKRAR EECCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHH EADQRDIVLYVPDRLLAYDRATGRGVNIAYEFAWKGKSTQGLPNDTAESAYTQTGRQGFA CCCCCCEEEEECCHHHHHCCCCCCCCEEEEEEEECCCCCCCCCCCHHHHHHHHCCCCCCC DHAPGEYAKVVEVAREHFARGDLFEAVPGQLFGEPCERSPAEVFKRLCRINPSPYGGLLN CCCCCHHHHHHHHHHHHHCCCCHHHHCCHHHCCCCCCCCHHHHHHHHHCCCCCCCCCEEE LGDGEFLVSASPEMFVRSDGRRIETCPISGTIARGVDAIADAEQIQKLLNSEKDEFELNM CCCCCEEEECCCCEEEECCCCEEEECCCCCHHHHHHHHHCCHHHHHHHHCCCCCCEEEEE CTDVDRNDKARVCVPGTIKVLARRQIETYSKLFHTVDHVEGMLRPGFDALDAFLTHAWAV ECCCCCCCCCEEEECHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHCEEEE TVTGAPKLWAMQFVEDHERSPRRWYAGAFGVVGFDGSINTGLTIRTIRMKDGLAEVRVGA EECCCCHHHHHHHHHHHCCCCCCEECCCCEEEEECCCCCCCEEEEEEEECCCHHHHEECE TCLFDSDPVAEDKECQVKAAALFQALRGDPPKPLSAVAPDATGSGKRVLLVDHDDSFVHM EEEECCCCCCCCCHHHHHHHHHHHHHCCCCCCCCHHCCCCCCCCCCEEEEEECCCHHHHH LADYFRQVGAQVSVVRHIHAQKMLAENAYDLLVLSPGPGRPADFKIALTIDTALAKQLPI HHHHHHHHCCHHHHHHHHHHHHHHHCCCCEEEEECCCCCCCCCEEEEEEECHHHHHHCCH FGVCLGVQAMGEYFGGTLGQLKQPAHGRPSRIQVRGGTLMHGLPNEITIGRYHSLYVDMQ HHHHHHHHHHHHHHCCCHHHHCCCCCCCCCEEEEECCEEECCCCCCEEEEEEEEEEEEHH DMPDALDVTASTEDGIAMAIEHKTLPVGGVQFHPESLMSLGGEVGLRIVENAFRLGRPMA HCCCCCEEECCCCCCEEEEEECCCCCCCCEEECHHHHHHCCHHHHHHHHHHHHHCCCCCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 8939798 [H]