Definition Dehalococcoides ethenogenes 195, complete genome.
Accession NC_002936
Length 1,469,720

Click here to switch to the map view.

The map label for this gene is trpG [H]

Identifier: 57233825

GI number: 57233825

Start: 1340634

End: 1341224

Strand: Direct

Name: trpG [H]

Synonym: DET1482

Alternate gene names: 57233825

Gene position: 1340634-1341224 (Clockwise)

Preceding gene: 57233826

Following gene: 57233824

Centisome position: 91.22

GC content: 46.7

Gene sequence:

>591_bases
ATGTTATTACTAATTGATAATTACGACAGTTTTACCTATAACCTTTTTCAGTATTTTTCCGAACTGGGGCAGGAGGTTAA
GGTAGTCCGCAATAACAAGATTACCCTTGATGCCATAGAAGCCCTAGGTCCTGAATATATCGTGATTTCACCCGGACCAT
CTTCACCCCTTCAGGCAGGGATGTCCAATGACATTATCCGCCATTTCGGCCCCAGACTGCCGATCCTCGGTATATGTCTG
GGTCACCAGTGCATCGGGCATACCTACGGGGGGATTGTCAGACAGGCAGACCGGATAATGCACGGCAAACAGTCTCTGAT
ACAGCATAACAACCGGGGTATTTTTAAAGGTCTGCCCAAAGGGTTTCCCGCCATACGTTACCATTCCCTTATAGTTGATA
AACCGACCCTACCGGAGTGTCTTGAAATAACCGCCTGGACAGATGACGGCACCATTATGGGGCTTAGGCACAAAGAGTAC
CCGGTTGAAGGCATACAGTTCCATCCCGAATCATTCAAAACCGAATGCGGCAAGGAGATTTTGGGCAATTTTCTGAAATA
CTATGCACCTGTATCAGGTAAAAGAGAGTAA

Upstream 100 bases:

>100_bases
GACAGCGTACCCGAACATGAGTATCAGGAAACATTAAACAAAGCTCAGGCTTTGCTGAAAGCTCTGGACAGGGCAGAAAA
TCAGGCATCGGAGAAACCGC

Downstream 100 bases:

>100_bases
ATAAATGATTAAAGAAGCCATCGGGTCTTTAGTTCTGGGTAAATCTCTGACTCTTGAACAGTCTGCCTCAGTCATGGACG
AAATCATGGAGGGAAAAACT

Product: anthranilate synthase component II

Products: NA

Alternate protein names: ADC synthase [H]

Number of amino acids: Translated: 196; Mature: 196

Protein sequence:

>196_residues
MLLLIDNYDSFTYNLFQYFSELGQEVKVVRNNKITLDAIEALGPEYIVISPGPSSPLQAGMSNDIIRHFGPRLPILGICL
GHQCIGHTYGGIVRQADRIMHGKQSLIQHNNRGIFKGLPKGFPAIRYHSLIVDKPTLPECLEITAWTDDGTIMGLRHKEY
PVEGIQFHPESFKTECGKEILGNFLKYYAPVSGKRE

Sequences:

>Translated_196_residues
MLLLIDNYDSFTYNLFQYFSELGQEVKVVRNNKITLDAIEALGPEYIVISPGPSSPLQAGMSNDIIRHFGPRLPILGICL
GHQCIGHTYGGIVRQADRIMHGKQSLIQHNNRGIFKGLPKGFPAIRYHSLIVDKPTLPECLEITAWTDDGTIMGLRHKEY
PVEGIQFHPESFKTECGKEILGNFLKYYAPVSGKRE
>Mature_196_residues
MLLLIDNYDSFTYNLFQYFSELGQEVKVVRNNKITLDAIEALGPEYIVISPGPSSPLQAGMSNDIIRHFGPRLPILGICL
GHQCIGHTYGGIVRQADRIMHGKQSLIQHNNRGIFKGLPKGFPAIRYHSLIVDKPTLPECLEITAWTDDGTIMGLRHKEY
PVEGIQFHPESFKTECGKEILGNFLKYYAPVSGKRE

Specific function: Catalyzes the biosynthesis of 4-amino-4-deoxychorismate (ADC) from chorismate and glutamine [H]

COG id: COG0512

COG function: function code EH; Anthranilate/para-aminobenzoate synthases component II

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 glutamine amidotransferase type-1 domain [H]

Homologues:

Organism=Escherichia coli, GI1789760, Length=185, Percent_Identity=55.1351351351351, Blast_Score=230, Evalue=5e-62,
Organism=Escherichia coli, GI1787517, Length=189, Percent_Identity=39.6825396825397, Blast_Score=137, Evalue=5e-34,
Organism=Saccharomyces cerevisiae, GI6322638, Length=185, Percent_Identity=50.2702702702703, Blast_Score=199, Evalue=3e-52,
Organism=Saccharomyces cerevisiae, GI6324361, Length=209, Percent_Identity=32.0574162679426, Blast_Score=83, Evalue=3e-17,
Organism=Drosophila melanogaster, GI281365319, Length=139, Percent_Identity=30.2158273381295, Blast_Score=66, Evalue=1e-11,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR006220
- InterPro:   IPR001317
- InterPro:   IPR011702
- InterPro:   IPR017926
- InterPro:   IPR000991
- InterPro:   IPR006221 [H]

Pfam domain/function: PF00117 GATase [H]

EC number: =2.6.1.85 [H]

Molecular weight: Translated: 22043; Mature: 22043

Theoretical pI: Translated: 7.61; Mature: 7.61

Prosite motif: PS00442 GATASE_TYPE_I

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

2.0 %Cys     (Translated Protein)
2.0 %Met     (Translated Protein)
4.1 %Cys+Met (Translated Protein)
2.0 %Cys     (Mature Protein)
2.0 %Met     (Mature Protein)
4.1 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MLLLIDNYDSFTYNLFQYFSELGQEVKVVRNNKITLDAIEALGPEYIVISPGPSSPLQAG
CEEEEECCCCHHHHHHHHHHHHHHHHHHHHCCCEEEEHHHHCCCCEEEECCCCCCHHHCC
MSNDIIRHFGPRLPILGICLGHQCIGHTYGGIVRQADRIMHGKQSLIQHNNRGIFKGLPK
CCCCHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCC
GFPAIRYHSLIVDKPTLPECLEITAWTDDGTIMGLRHKEYPVEGIQFHPESFKTECGKEI
CCCCHHHHEEEECCCCCHHHEEEEEECCCCEEEEEECCCCCCCCEEECCHHHHHHHHHHH
LGNFLKYYAPVSGKRE
HHHHHHHHCCCCCCCC
>Mature Secondary Structure
MLLLIDNYDSFTYNLFQYFSELGQEVKVVRNNKITLDAIEALGPEYIVISPGPSSPLQAG
CEEEEECCCCHHHHHHHHHHHHHHHHHHHHCCCEEEEHHHHCCCCEEEECCCCCCHHHCC
MSNDIIRHFGPRLPILGICLGHQCIGHTYGGIVRQADRIMHGKQSLIQHNNRGIFKGLPK
CCCCHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCC
GFPAIRYHSLIVDKPTLPECLEITAWTDDGTIMGLRHKEYPVEGIQFHPESFKTECGKEI
CCCCHHHHEEEECCCCCHHHEEEEEECCCCEEEEEECCCCCCCCEEECCHHHHHHHHHHH
LGNFLKYYAPVSGKRE
HHHHHHHHCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: 3894673; 2403545; 11677609 [H]