Definition Azorhizobium caulinodans ORS 571, complete genome.
Accession NC_009937
Length 5,369,772

Click here to switch to the map view.

The map label for this gene is ycgM [C]

Identifier: 158423894

GI number: 158423894

Start: 2594992

End: 2595846

Strand: Reverse

Name: ycgM [C]

Synonym: AZC_2270

Alternate gene names: 158423894

Gene position: 2595846-2594992 (Counterclockwise)

Preceding gene: 158423895

Following gene: 158423893

Centisome position: 48.34

GC content: 64.68

Gene sequence:

>855_bases
ATGAAGCTTCTGCGTTACGGCCCCGCGGGCCAGGAAAAGCCCGGCCTCCTCGATGAGGCCGGCAAGATCCGCGATCTGTC
GGGCGTCATCTCCGACCTCACCGGTGAGGCCATCACGCCCGAGGGGCTGGCCAAGCTGAAGACGCTGGACGTGTCGTCTT
TGCCGGTGGTGGAGGGCACGCCGCGTTATGGCGCGCCGGTTGCCAACGTGGCCAAGTTCATCGCCATCGGCCTGAACTTC
ACCGACCATGCGGCGGAATCGAACCTGCCGATCCCGTCCGAGCCGGTGGTCTTCATGAAGGCCACCTCCTGCATCCAGGG
TCCGAACGACGCCGTGGTGATCCCGCGCGGCTCGAAGAAGACCGACTGGGAAGTGGAACTGGGCATCGTCATCGGCAAGC
GCGCCTCCTACGTCACGAAGGACGAGGCGCTCGATCACGTGGCCGGCTACGTCCTCATCAATGACGTGTCGGAGCGCGAG
TACCAGATCGAGCGTGGCGGCACCTGGGACAAGGGCAAGGGCTGCGACACCTTCGGCCCCATCGGCCCGTGGCTCGTCAC
CTCCGACGAGGTGGGCGACGTGCAGCAGCTCGGCATGTGGCTGGACGTGAACGGCCAGCGCCGCCAGACCGGCAACACGT
CCACCATGATCTTCGATGTGAAGACCATCGTGAGCTACCTGTCGGAATTCATGACCCTGCTGCCGGGTGACATCATCACC
ACCGGCACCCCTCCGGGCGTCGGCATGGGCATCAAGCCCGAGGCGGTCTATCTCAAGGCCGGCGACGTCATTGAGCTGGG
TATCGACAAGCTCGGCCGTCAGAAGCAGACCTGCGTCGCCTGGGAGAAGAAGTAA

Upstream 100 bases:

>100_bases
CGGCCGCCTGAAGCTCGACGACACCCCCGGCTTCGGCGTGCGCCTGAACCCCGAGTGCAAGCTCTCGCGCCCCTACACCC
ACTGAGGCGAACGAAATTCC

Downstream 100 bases:

>100_bases
TGGTTGATAGCACTCGCTTTTCGGGCCGCGTCGCGGTCGTCACCGGCGGTGCGGCCGGCATCGGCCTCGCCATCGCCCAG
CGCATCATCGCCGAGGGCGG

Product: 2-hydroxyhepta-2,4-diene-1,7-dioate isomerase

Products: NA

Alternate protein names: UGL; Ureidoglycolase; Ureidoglycolatase; Ureidoglycolate hydrolase [H]

Number of amino acids: Translated: 284; Mature: 284

Protein sequence:

>284_residues
MKLLRYGPAGQEKPGLLDEAGKIRDLSGVISDLTGEAITPEGLAKLKTLDVSSLPVVEGTPRYGAPVANVAKFIAIGLNF
TDHAAESNLPIPSEPVVFMKATSCIQGPNDAVVIPRGSKKTDWEVELGIVIGKRASYVTKDEALDHVAGYVLINDVSERE
YQIERGGTWDKGKGCDTFGPIGPWLVTSDEVGDVQQLGMWLDVNGQRRQTGNTSTMIFDVKTIVSYLSEFMTLLPGDIIT
TGTPPGVGMGIKPEAVYLKAGDVIELGIDKLGRQKQTCVAWEKK

Sequences:

>Translated_284_residues
MKLLRYGPAGQEKPGLLDEAGKIRDLSGVISDLTGEAITPEGLAKLKTLDVSSLPVVEGTPRYGAPVANVAKFIAIGLNF
TDHAAESNLPIPSEPVVFMKATSCIQGPNDAVVIPRGSKKTDWEVELGIVIGKRASYVTKDEALDHVAGYVLINDVSERE
YQIERGGTWDKGKGCDTFGPIGPWLVTSDEVGDVQQLGMWLDVNGQRRQTGNTSTMIFDVKTIVSYLSEFMTLLPGDIIT
TGTPPGVGMGIKPEAVYLKAGDVIELGIDKLGRQKQTCVAWEKK
>Mature_284_residues
MKLLRYGPAGQEKPGLLDEAGKIRDLSGVISDLTGEAITPEGLAKLKTLDVSSLPVVEGTPRYGAPVANVAKFIAIGLNF
TDHAAESNLPIPSEPVVFMKATSCIQGPNDAVVIPRGSKKTDWEVELGIVIGKRASYVTKDEALDHVAGYVLINDVSERE
YQIERGGTWDKGKGCDTFGPIGPWLVTSDEVGDVQQLGMWLDVNGQRRQTGNTSTMIFDVKTIVSYLSEFMTLLPGDIIT
TGTPPGVGMGIKPEAVYLKAGDVIELGIDKLGRQKQTCVAWEKK

Specific function: Unknown

COG id: COG0179

COG function: function code Q; 2-keto-4-pentenoate hydratase/2-oxohepta-3-ene-1,7-dioic acid hydratase (catechol pathway)

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the FAH family [H]

Homologues:

Organism=Homo sapiens, GI156231349, Length=226, Percent_Identity=45.1327433628319, Blast_Score=207, Evalue=9e-54,
Organism=Homo sapiens, GI40786394, Length=211, Percent_Identity=45.0236966824645, Blast_Score=199, Evalue=3e-51,
Organism=Homo sapiens, GI66348062, Length=208, Percent_Identity=37.5, Blast_Score=135, Evalue=6e-32,
Organism=Homo sapiens, GI215422413, Length=204, Percent_Identity=36.7647058823529, Blast_Score=134, Evalue=6e-32,
Organism=Homo sapiens, GI13654274, Length=202, Percent_Identity=37.1287128712871, Blast_Score=134, Evalue=9e-32,
Organism=Escherichia coli, GI1787428, Length=203, Percent_Identity=31.5270935960591, Blast_Score=115, Evalue=4e-27,
Organism=Caenorhabditis elegans, GI17557057, Length=207, Percent_Identity=35.7487922705314, Blast_Score=134, Evalue=5e-32,
Organism=Saccharomyces cerevisiae, GI6324161, Length=213, Percent_Identity=33.3333333333333, Blast_Score=102, Evalue=8e-23,
Organism=Drosophila melanogaster, GI28572127, Length=288, Percent_Identity=40.9722222222222, Blast_Score=181, Evalue=7e-46,
Organism=Drosophila melanogaster, GI24663695, Length=212, Percent_Identity=37.7358490566038, Blast_Score=154, Evalue=7e-38,
Organism=Drosophila melanogaster, GI28571789, Length=210, Percent_Identity=38.5714285714286, Blast_Score=142, Evalue=3e-34,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR002529
- InterPro:   IPR011234 [H]

Pfam domain/function: PF01557 FAA_hydrolase [H]

EC number: =4.3.2.3 [H]

Molecular weight: Translated: 30544; Mature: 30544

Theoretical pI: Translated: 4.81; Mature: 4.81

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.1 %Cys     (Translated Protein)
2.1 %Met     (Translated Protein)
3.2 %Cys+Met (Translated Protein)
1.1 %Cys     (Mature Protein)
2.1 %Met     (Mature Protein)
3.2 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKLLRYGPAGQEKPGLLDEAGKIRDLSGVISDLTGEAITPEGLAKLKTLDVSSLPVVEGT
CCEEECCCCCCCCCCCCCCCCCHHHHHHHHHHHCCCCCCHHHHHHEEEECCCCCCCCCCC
PRYGAPVANVAKFIAIGLNFTDHAAESNLPIPSEPVVFMKATSCIQGPNDAVVIPRGSKK
CCCCCCHHHHHHHHHHCCCCCHHCCCCCCCCCCCCEEEEEEHHHHCCCCCEEEEECCCCC
TDWEVELGIVIGKRASYVTKDEALDHVAGYVLINDVSEREYQIERGGTWDKGKGCDTFGP
CCCEEEEEEEEECCCCCCCHHHHHHHHHCEEEEECCCCCEEEEECCCCCCCCCCCCCCCC
IGPWLVTSDEVGDVQQLGMWLDVNGQRRQTGNTSTMIFDVKTIVSYLSEFMTLLPGDIIT
CCCEEEECCCCCCHHHCCEEEECCCCCCCCCCCEEEEEEHHHHHHHHHHHHHHCCCCEEE
TGTPPGVGMGIKPEAVYLKAGDVIELGIDKLGRQKQTCVAWEKK
CCCCCCCCCCCCCCEEEEECCCEEEECHHHHCCCCCCEEEECCC
>Mature Secondary Structure
MKLLRYGPAGQEKPGLLDEAGKIRDLSGVISDLTGEAITPEGLAKLKTLDVSSLPVVEGT
CCEEECCCCCCCCCCCCCCCCCHHHHHHHHHHHCCCCCCHHHHHHEEEECCCCCCCCCCC
PRYGAPVANVAKFIAIGLNFTDHAAESNLPIPSEPVVFMKATSCIQGPNDAVVIPRGSKK
CCCCCCHHHHHHHHHHCCCCCHHCCCCCCCCCCCCEEEEEEHHHHCCCCCEEEEECCCCC
TDWEVELGIVIGKRASYVTKDEALDHVAGYVLINDVSEREYQIERGGTWDKGKGCDTFGP
CCCEEEEEEEEECCCCCCCHHHHHHHHHCEEEEECCCCCEEEEECCCCCCCCCCCCCCCC
IGPWLVTSDEVGDVQQLGMWLDVNGQRRQTGNTSTMIFDVKTIVSYLSEFMTLLPGDIIT
CCCEEEECCCCCCHHHCCEEEECCCCCCCCCCCEEEEEEHHHHHHHHHHHHHHCCCCEEE
TGTPPGVGMGIKPEAVYLKAGDVIELGIDKLGRQKQTCVAWEKK
CCCCCCCCCCCCCCEEEEECCCEEEECHHHHCCCCCCEEEECCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: NA