Definition Symbiobacterium thermophilum IAM 14863 chromosome, complete genome.
Accession NC_006177
Length 3,566,135

Click here to switch to the map view.

The map label for this gene is hutU

Identifier: 51894328

GI number: 51894328

Start: 3401076

End: 3402731

Strand: Reverse

Name: hutU

Synonym: STH3193

Alternate gene names: 51894328

Gene position: 3402731-3401076 (Counterclockwise)

Preceding gene: 51894329

Following gene: 51894327

Centisome position: 95.42

GC content: 69.69

Gene sequence:

>1656_bases
ATGGAGATGACCCGGACGGTCCGCGCCCCGCGCGGCACGCAGCTCTCGTGCAAGGGGTGGCAGCAGGAGGCCGCCCTGCG
GATGCTCATGAACAACCTGGACCCCGAGGTGGCCGAGCGGCCGGAGGAGCTGGTGGTCTACGGCGGCAGCGGGAAGGCCG
CCCGCTCCTGGGAGGCCTTCGACGCTATTGTGAAGGCGCTGCGCAGTCTGGAGGACGACGAGACGCTGCTCGTCCAGTCC
GGCAAGCCGGTGGCGATCTTCCGCACGCACCGCATGGCCCCGCGCGTCCTGATCGCCAACTCCAACCTGGTCGCACGCTG
GGCAACCTGGGAGCACTTCTGGGAGCTGGAGCGTAAGGGGCTCATGATGTTCGGCCAGATGACCGCCGGCTCGTGGATCT
ACATCGGCACCCAGGGCATCCTCCAGGGCACTTACGAGACCTTTGCCGAGGCCGCCCGGCAGCACTTCGGCGGCAGCCTG
AAGGGGCGGCTGGCCCTGACGGCGGGCCTGGGCGGCATGGGCGGCGCCCAGCCGCTGGCGGTGACGATGAACGAGGGCGT
CGCCATCGTCGTGGAGGTGGACGAGGCGCGCATCCAGCGCCGTCTGGATCACCGCTACCTGGACCGCATGACCCGCAGCC
TGGACGAGGCCCTGGCCTGGGCCCGGGAGTCCATGGCGAAGGGGGAGCCGCTCTCCATCGGCCTGCTGGGCAACGCCGCG
ACGATCTATCCGGAGATCGTCCGCCGCGGCGTGATCCCCGACGTGGTGACCGACCAGACCTCCGCCCACGACCCGCTGAA
CGGCTACATCCCCGAAGGGCTCTCGGTGCAGGAGGCGGCAAAGCTGCGCAAGGCGGACCCCGACGAGTACATCCGGCGGG
CCAAGGCCAGCATCGTGAAGCACGTGCAGGCGATGCTGGACATGCAGAAGGCGGGGGCCGTGGTGTTCGACTACGGCAAC
AACATCCGGCAGCAGGCGTACGAGGAAGGGCTGAAGGACGCCTTCGCCTTCCCGGGATTCGTGCCGGCCTTCATCCGGCC
GCTGTTCTGCGAGGGCAAGGGCCCCTTCCGGTGGGTGGCGCTCTCCGGCGACCCGGAGGACATCTACAAGACCGACCGGG
CGATCATGGAGCTGTTCCCCGAGAACCAGTCGCTGCGCCGGTGGCTGGAGATGGCGCAGAAGAAGGTTCACTTCCAGGGG
CTGCCGGCCCGCATCTGCTGGCTCGGCTACGGCGAGCGGGTGAAGGCAGGGCTGAAGTTCAACGAGATGGTCGCGAGCGG
CGAGCTGAAGGCGCCCATCGTCATCGGGCGCGATCACCTGGACGCGGGTTCGGTGGCCTCGCCCAATCGGGAGACCGAGG
CGATGAAGGACGGTTCCGACGCGGTCGCCGACTGGCCGCTGCTGAACGCGCTGGTCAACACGGCCGCGGGCGCGACCTGG
GTCTCGATCCACCACGGTGGCGGCGTGGGCATCGGCTACAGCCAGCACGCCGGCATGGTGGTGGTCGCGGACGGCACCGA
GGAGGCGCGGGTGCGGCTGGAGCGGGTGCTGACCACCGACCCGGGCATGGGCGTGGTGCGGCACGTGGACGCCGGGTACG
AAAAGGCCCTGCAGGTCGCCCGGGAGCGGGGCATCCGGCTGCCCATGTACGAGTGA

Upstream 100 bases:

>100_bases
GGCCCTCGCCGAACTGGTGCACAACGGGGAACTGGTCGCCGCCGTCGAGGCAGTGGCCGGTCCCCTCGAGTAGCGCAGTC
GTAACCGAAACGAGGGGGGT

Downstream 100 bases:

>100_bases
GCCGGGCGTGGAGGACAACCGGGGAGGAGGCGGTCCCTTGAATCCGAACGCGCTGGTTGAGTGCGTGCCCAACTTCAGCG
AGGGGCGGCGGCCGGAGGTG

Product: urocanate hydratase

Products: NA

Alternate protein names: Urocanase; Imidazolonepropionate hydrolase

Number of amino acids: Translated: 551; Mature: 551

Protein sequence:

>551_residues
MEMTRTVRAPRGTQLSCKGWQQEAALRMLMNNLDPEVAERPEELVVYGGSGKAARSWEAFDAIVKALRSLEDDETLLVQS
GKPVAIFRTHRMAPRVLIANSNLVARWATWEHFWELERKGLMMFGQMTAGSWIYIGTQGILQGTYETFAEAARQHFGGSL
KGRLALTAGLGGMGGAQPLAVTMNEGVAIVVEVDEARIQRRLDHRYLDRMTRSLDEALAWARESMAKGEPLSIGLLGNAA
TIYPEIVRRGVIPDVVTDQTSAHDPLNGYIPEGLSVQEAAKLRKADPDEYIRRAKASIVKHVQAMLDMQKAGAVVFDYGN
NIRQQAYEEGLKDAFAFPGFVPAFIRPLFCEGKGPFRWVALSGDPEDIYKTDRAIMELFPENQSLRRWLEMAQKKVHFQG
LPARICWLGYGERVKAGLKFNEMVASGELKAPIVIGRDHLDAGSVASPNRETEAMKDGSDAVADWPLLNALVNTAAGATW
VSIHHGGGVGIGYSQHAGMVVVADGTEEARVRLERVLTTDPGMGVVRHVDAGYEKALQVARERGIRLPMYE

Sequences:

>Translated_551_residues
MEMTRTVRAPRGTQLSCKGWQQEAALRMLMNNLDPEVAERPEELVVYGGSGKAARSWEAFDAIVKALRSLEDDETLLVQS
GKPVAIFRTHRMAPRVLIANSNLVARWATWEHFWELERKGLMMFGQMTAGSWIYIGTQGILQGTYETFAEAARQHFGGSL
KGRLALTAGLGGMGGAQPLAVTMNEGVAIVVEVDEARIQRRLDHRYLDRMTRSLDEALAWARESMAKGEPLSIGLLGNAA
TIYPEIVRRGVIPDVVTDQTSAHDPLNGYIPEGLSVQEAAKLRKADPDEYIRRAKASIVKHVQAMLDMQKAGAVVFDYGN
NIRQQAYEEGLKDAFAFPGFVPAFIRPLFCEGKGPFRWVALSGDPEDIYKTDRAIMELFPENQSLRRWLEMAQKKVHFQG
LPARICWLGYGERVKAGLKFNEMVASGELKAPIVIGRDHLDAGSVASPNRETEAMKDGSDAVADWPLLNALVNTAAGATW
VSIHHGGGVGIGYSQHAGMVVVADGTEEARVRLERVLTTDPGMGVVRHVDAGYEKALQVARERGIRLPMYE
>Mature_551_residues
MEMTRTVRAPRGTQLSCKGWQQEAALRMLMNNLDPEVAERPEELVVYGGSGKAARSWEAFDAIVKALRSLEDDETLLVQS
GKPVAIFRTHRMAPRVLIANSNLVARWATWEHFWELERKGLMMFGQMTAGSWIYIGTQGILQGTYETFAEAARQHFGGSL
KGRLALTAGLGGMGGAQPLAVTMNEGVAIVVEVDEARIQRRLDHRYLDRMTRSLDEALAWARESMAKGEPLSIGLLGNAA
TIYPEIVRRGVIPDVVTDQTSAHDPLNGYIPEGLSVQEAAKLRKADPDEYIRRAKASIVKHVQAMLDMQKAGAVVFDYGN
NIRQQAYEEGLKDAFAFPGFVPAFIRPLFCEGKGPFRWVALSGDPEDIYKTDRAIMELFPENQSLRRWLEMAQKKVHFQG
LPARICWLGYGERVKAGLKFNEMVASGELKAPIVIGRDHLDAGSVASPNRETEAMKDGSDAVADWPLLNALVNTAAGATW
VSIHHGGGVGIGYSQHAGMVVVADGTEEARVRLERVLTTDPGMGVVRHVDAGYEKALQVARERGIRLPMYE

Specific function: Unknown

COG id: COG2987

COG function: function code E; Urocanate hydratase

Gene ontology:

Cell location: Cytoplasm

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Belongs to the urocanase family

Homologues:

Organism=Homo sapiens, GI21389467, Length=554, Percent_Identity=35.0180505415162, Blast_Score=328, Evalue=9e-90,
Organism=Homo sapiens, GI260306182, Length=614, Percent_Identity=32.2475570032573, Blast_Score=306, Evalue=3e-83,
Organism=Caenorhabditis elegans, GI71997891, Length=552, Percent_Identity=33.8768115942029, Blast_Score=328, Evalue=4e-90,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): HUTU_SYMTH (Q67JH5)

Other databases:

- EMBL:   AP006840
- RefSeq:   YP_077019.1
- HSSP:   P25080
- ProteinModelPortal:   Q67JH5
- SMR:   Q67JH5
- GeneID:   2981799
- GenomeReviews:   AP006840_GR
- KEGG:   sth:STH3193
- NMPDR:   fig|292459.1.peg.3064
- HOGENOM:   HBG305285
- OMA:   MGVANYG
- ProtClustDB:   PRK05414
- BioCyc:   STHE292459:STH3193-MONOMER
- BRENDA:   4.2.1.49
- GO:   GO:0005737
- HAMAP:   MF_00577
- InterPro:   IPR000193
- PIRSF:   PIRSF001423
- TIGRFAMs:   TIGR01228

Pfam domain/function: PF01175 Urocanase; SSF111326 Urocanase

EC number: =4.2.1.49

Molecular weight: Translated: 60753; Mature: 60753

Theoretical pI: Translated: 6.81; Mature: 6.81

Prosite motif: PS01233 UROCANASE

Important sites: ACT_SITE 406-406

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.5 %Cys     (Translated Protein)
3.8 %Met     (Translated Protein)
4.4 %Cys+Met (Translated Protein)
0.5 %Cys     (Mature Protein)
3.8 %Met     (Mature Protein)
4.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MEMTRTVRAPRGTQLSCKGWQQEAALRMLMNNLDPEVAERPEELVVYGGSGKAARSWEAF
CCCCCCCCCCCCCEECCCCHHHHHHHHHHHHCCCHHHHCCCCEEEEECCCCCCCCCHHHH
DAIVKALRSLEDDETLLVQSGKPVAIFRTHRMAPRVLIANSNLVARWATWEHFWELERKG
HHHHHHHHCCCCCCEEEEECCCCEEEEEECCCCCEEEEECCCEEEEHHHHHHHHHHHHCC
LMMFGQMTAGSWIYIGTQGILQGTYETFAEAARQHFGGSLKGRLALTAGLGGMGGAQPLA
EEEEEEECCCCEEEEECHHHHHHHHHHHHHHHHHHCCCCCCCEEEEEECCCCCCCCCCEE
VTMNEGVAIVVEVDEARIQRRLDHRYLDRMTRSLDEALAWARESMAKGEPLSIGLLGNAA
EEECCCEEEEEEECHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCEEEEEECCCH
TIYPEIVRRGVIPDVVTDQTSAHDPLNGYIPEGLSVQEAAKLRKADPDEYIRRAKASIVK
HHHHHHHHCCCCCCHHCCCCCCCCCCCCCCCCCCCHHHHHHHHCCCHHHHHHHHHHHHHH
HVQAMLDMQKAGAVVFDYGNNIRQQAYEEGLKDAFAFPGFVPAFIRPLFCEGKGPFRWVA
HHHHHHHHHHCCEEEEECCCHHHHHHHHHHHHHHHCCCCHHHHHHHHHHCCCCCCEEEEE
LSGDPEDIYKTDRAIMELFPENQSLRRWLEMAQKKVHFQGLPARICWLGYGERVKAGLKF
ECCCHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHCCCCCEEEEEECCCHHHHCCCCH
NEMVASGELKAPIVIGRDHLDAGSVASPNRETEAMKDGSDAVADWPLLNALVNTAAGATW
HHHHHCCCCCCCEEEECCCCCCCCCCCCCCHHHHHCCCCCHHHHHHHHHHHHHHCCCCEE
VSIHHGGGVGIGYSQHAGMVVVADGTEEARVRLERVLTTDPGMGVVRHVDAGYEKALQVA
EEEECCCCCCCCCCCCCCEEEEECCCHHHHHHHHHHHCCCCCCCHHHHCCCCHHHHHHHH
RERGIRLPMYE
HHCCCCCCCCC
>Mature Secondary Structure
MEMTRTVRAPRGTQLSCKGWQQEAALRMLMNNLDPEVAERPEELVVYGGSGKAARSWEAF
CCCCCCCCCCCCCEECCCCHHHHHHHHHHHHCCCHHHHCCCCEEEEECCCCCCCCCHHHH
DAIVKALRSLEDDETLLVQSGKPVAIFRTHRMAPRVLIANSNLVARWATWEHFWELERKG
HHHHHHHHCCCCCCEEEEECCCCEEEEEECCCCCEEEEECCCEEEEHHHHHHHHHHHHCC
LMMFGQMTAGSWIYIGTQGILQGTYETFAEAARQHFGGSLKGRLALTAGLGGMGGAQPLA
EEEEEEECCCCEEEEECHHHHHHHHHHHHHHHHHHCCCCCCCEEEEEECCCCCCCCCCEE
VTMNEGVAIVVEVDEARIQRRLDHRYLDRMTRSLDEALAWARESMAKGEPLSIGLLGNAA
EEECCCEEEEEEECHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCEEEEEECCCH
TIYPEIVRRGVIPDVVTDQTSAHDPLNGYIPEGLSVQEAAKLRKADPDEYIRRAKASIVK
HHHHHHHHCCCCCCHHCCCCCCCCCCCCCCCCCCCHHHHHHHHCCCHHHHHHHHHHHHHH
HVQAMLDMQKAGAVVFDYGNNIRQQAYEEGLKDAFAFPGFVPAFIRPLFCEGKGPFRWVA
HHHHHHHHHHCCEEEEECCCHHHHHHHHHHHHHHHCCCCHHHHHHHHHHCCCCCCEEEEE
LSGDPEDIYKTDRAIMELFPENQSLRRWLEMAQKKVHFQGLPARICWLGYGERVKAGLKF
ECCCHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHCCCCCEEEEEECCCHHHHCCCCH
NEMVASGELKAPIVIGRDHLDAGSVASPNRETEAMKDGSDAVADWPLLNALVNTAAGATW
HHHHHCCCCCCCEEEECCCCCCCCCCCCCCHHHHHCCCCCHHHHHHHHHHHHHHCCCCEE
VSIHHGGGVGIGYSQHAGMVVVADGTEEARVRLERVLTTDPGMGVVRHVDAGYEKALQVA
EEEECCCCCCCCCCCCCCEEEEECCCHHHHHHHHHHHCCCCCCCHHHHCCCCHHHHHHHH
RERGIRLPMYE
HHCCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA