| Definition | Escherichia coli HS, complete genome. |
|---|---|
| Accession | NC_009800 |
| Length | 4,643,538 |
Click here to switch to the map view.
The map label for this gene is hyuA [H]
Identifier: 157162334
GI number: 157162334
Start: 3037542
End: 3038927
Strand: Direct
Name: hyuA [H]
Synonym: EcHS_A3033
Alternate gene names: 157162334
Gene position: 3037542-3038927 (Clockwise)
Preceding gene: 157162333
Following gene: 157162335
Centisome position: 65.41
GC content: 53.17
Gene sequence:
>1386_bases ATGCGCGTATTGATCAAAAACGGCACTGTCGTTAACGCAGATGGACAAGCCAAACAGGATTTGCTGATTGAAAGCGGGAT TGTTCGCCAGTTGGGCAACAATATTTCGCCGCAGCTCCCGTATGAAGAAATTGATGCCACTGGCTGTTACGTTTTCCCTG GCGGCGTGGATGTCCATACGCATTTCAATATTGATGTCGGCATCGCGCGCAGTTGTGATGATTTTTTTACCGGTACCCGC GCAGCTGCGTGTGGCGGTACAACAACCATTATTGACCATATGGGATTTGGCCCAAACGGCTGTCGGTTACGCCATCAACT GGAGGTTTATCGTGGTTATGCCGCCCATAAAGCGGTCATCGATTACAGCTTTCACGGTGTGATCCAGCACATTAATCACG CAATCCTCGACGAAATCCCGATGATGGCCGAGGAAGGACTGAGCAGTTTTAAACTCTATTTAACCTATCAATACAAACTC AACGATGACGAGGTTTTGCAGGCATTACGCCGTCTGCATGAATCCGGCGCGCTGACCACCGTGCACCCGGAAAATGATGC GGCTATCGCCAGCAAGCGGGCGGAGTTTATCGCCGCAGGGTTAACCGCGCCGCGCTATCACGCCTTGAGTCGCCCTCTGG AATGCGAAGCGGAAGCCATCGCCCGCATGATTAACCTGGCACAAATTGCCGGTAACGCCCCGCTCTATATCGTGCACCTG TCTAACGGCTTAGGTCTGGATTATCTGCGTCTTGCCCGTGCGAATCACCAGCCAGTCTGGGTTGAAACCTGCCCACAATA TCTCCTGTTGGACGAACGCAGTTACGATACAGAAGATGGCATGAAGTTCATTCTTAGCCCACCGCTGCGTAACGTACGCG AGCAGGACAAACTGTGGTGTGGCATCAGCGATGGTGCGATTGACGTGGTGGCAACCGATCACTGCACCTTCTCGATGGCT CAACGCCTGCAAATTTCTAAAGGCGATTTCAGTCGCTGCCCAAATGGCTTACCCGGTGTGGAAAACCGCATGCAGTTACT GTTTTCCAGTGGCGTGATGACGGGACGTATAACACCGGAACGCTTTGTTGAATTAACCAGCGCAATGCCCGCCAGGCTGT TTGGCCTGTGGCCGCAAAAAGGATTATTAGCGCCCGGTTCCGACGGCGACGTGGTGATTATCGACCCACGTCAGAGCCAA CAAATTCAGCATCGCCATCTCCACGACAACGCCGACTACTCGCCATGGGAGGGTTTTACCTGTCAGGGCGCGATTGTCAG AACCTTATCCCGTGGTGAAACGATTTTCTGTGACGGCACCTTTACAGGCAAAGCCGGGCGAGGTCGTTTCCTGCGACGCA AACCGTTTGTCCCTCCCGTGCTCTAA
Upstream 100 bases:
>100_bases GCCGCGATGTACGCTGCAATCCCGTTAAGCTGGCTGGCAACCGAATAATTACTCTTCACTTATTCCCCTCCGGTTCGCCG GAGGGTTTTTGGAGTTTGCT
Downstream 100 bases:
>100_bases CCACTGCCAGGGATCTATACACAATCAAGAATGATGAGTGAGGAAAAATGAGTAAGAAAATTGTTCTCGCCCTGGGCGGG AATGCGCTGGGCGATGACCT
Product: phenylhydantoinase
Products: NA
Alternate protein names: Hydantoin-utilizing enzyme hyuA [H]
Number of amino acids: Translated: 461; Mature: 461
Protein sequence:
>461_residues MRVLIKNGTVVNADGQAKQDLLIESGIVRQLGNNISPQLPYEEIDATGCYVFPGGVDVHTHFNIDVGIARSCDDFFTGTR AAACGGTTTIIDHMGFGPNGCRLRHQLEVYRGYAAHKAVIDYSFHGVIQHINHAILDEIPMMAEEGLSSFKLYLTYQYKL NDDEVLQALRRLHESGALTTVHPENDAAIASKRAEFIAAGLTAPRYHALSRPLECEAEAIARMINLAQIAGNAPLYIVHL SNGLGLDYLRLARANHQPVWVETCPQYLLLDERSYDTEDGMKFILSPPLRNVREQDKLWCGISDGAIDVVATDHCTFSMA QRLQISKGDFSRCPNGLPGVENRMQLLFSSGVMTGRITPERFVELTSAMPARLFGLWPQKGLLAPGSDGDVVIIDPRQSQ QIQHRHLHDNADYSPWEGFTCQGAIVRTLSRGETIFCDGTFTGKAGRGRFLRRKPFVPPVL
Sequences:
>Translated_461_residues MRVLIKNGTVVNADGQAKQDLLIESGIVRQLGNNISPQLPYEEIDATGCYVFPGGVDVHTHFNIDVGIARSCDDFFTGTR AAACGGTTTIIDHMGFGPNGCRLRHQLEVYRGYAAHKAVIDYSFHGVIQHINHAILDEIPMMAEEGLSSFKLYLTYQYKL NDDEVLQALRRLHESGALTTVHPENDAAIASKRAEFIAAGLTAPRYHALSRPLECEAEAIARMINLAQIAGNAPLYIVHL SNGLGLDYLRLARANHQPVWVETCPQYLLLDERSYDTEDGMKFILSPPLRNVREQDKLWCGISDGAIDVVATDHCTFSMA QRLQISKGDFSRCPNGLPGVENRMQLLFSSGVMTGRITPERFVELTSAMPARLFGLWPQKGLLAPGSDGDVVIIDPRQSQ QIQHRHLHDNADYSPWEGFTCQGAIVRTLSRGETIFCDGTFTGKAGRGRFLRRKPFVPPVL >Mature_461_residues MRVLIKNGTVVNADGQAKQDLLIESGIVRQLGNNISPQLPYEEIDATGCYVFPGGVDVHTHFNIDVGIARSCDDFFTGTR AAACGGTTTIIDHMGFGPNGCRLRHQLEVYRGYAAHKAVIDYSFHGVIQHINHAILDEIPMMAEEGLSSFKLYLTYQYKL NDDEVLQALRRLHESGALTTVHPENDAAIASKRAEFIAAGLTAPRYHALSRPLECEAEAIARMINLAQIAGNAPLYIVHL SNGLGLDYLRLARANHQPVWVETCPQYLLLDERSYDTEDGMKFILSPPLRNVREQDKLWCGISDGAIDVVATDHCTFSMA QRLQISKGDFSRCPNGLPGVENRMQLLFSSGVMTGRITPERFVELTSAMPARLFGLWPQKGLLAPGSDGDVVIIDPRQSQ QIQHRHLHDNADYSPWEGFTCQGAIVRTLSRGETIFCDGTFTGKAGRGRFLRRKPFVPPVL
Specific function: Catalyzes the stereospecific hydrolysis of the cyclic amide bond of D-hydantoin derivatives with an aromatic side chains at the 5'-position. Has no activity on dihydropyrimidines. The physiological function is unknown [H]
COG id: COG0044
COG function: function code F; Dihydroorotase and related cyclic amidohydrolases
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the DHOase family. Hydantoinase/dihydropyrimidinase subfamily [H]
Homologues:
Organism=Homo sapiens, GI4503375, Length=466, Percent_Identity=36.480686695279, Blast_Score=296, Evalue=3e-80, Organism=Homo sapiens, GI4503379, Length=462, Percent_Identity=35.0649350649351, Blast_Score=281, Evalue=1e-75, Organism=Homo sapiens, GI4503377, Length=462, Percent_Identity=35.2813852813853, Blast_Score=278, Evalue=6e-75, Organism=Homo sapiens, GI4503051, Length=462, Percent_Identity=35.2813852813853, Blast_Score=275, Evalue=6e-74, Organism=Homo sapiens, GI62422571, Length=462, Percent_Identity=35.2813852813853, Blast_Score=274, Evalue=1e-73, Organism=Homo sapiens, GI190194363, Length=462, Percent_Identity=33.982683982684, Blast_Score=264, Evalue=1e-70, Organism=Homo sapiens, GI19923821, Length=463, Percent_Identity=34.1252699784017, Blast_Score=264, Evalue=2e-70, Organism=Homo sapiens, GI18105007, Length=405, Percent_Identity=23.7037037037037, Blast_Score=87, Evalue=5e-17, Organism=Escherichia coli, GI87082175, Length=461, Percent_Identity=99.5661605206074, Blast_Score=956, Evalue=0.0, Organism=Escherichia coli, GI1786722, Length=444, Percent_Identity=29.7297297297297, Blast_Score=171, Evalue=7e-44, Organism=Caenorhabditis elegans, GI71989490, Length=467, Percent_Identity=36.4025695931477, Blast_Score=277, Evalue=9e-75, Organism=Caenorhabditis elegans, GI17539558, Length=463, Percent_Identity=36.0691144708423, Blast_Score=270, Evalue=1e-72, Organism=Caenorhabditis elegans, GI86575075, Length=468, Percent_Identity=27.991452991453, Blast_Score=167, Evalue=1e-41, Organism=Caenorhabditis elegans, GI193204318, Length=409, Percent_Identity=25.4278728606357, Blast_Score=100, Evalue=3e-21, Organism=Saccharomyces cerevisiae, GI6322218, Length=423, Percent_Identity=27.4231678486998, Blast_Score=125, Evalue=1e-29, Organism=Drosophila melanogaster, GI221377917, Length=481, Percent_Identity=35.7588357588358, Blast_Score=269, Evalue=3e-72, Organism=Drosophila melanogaster, GI17137462, Length=468, Percent_Identity=35.6837606837607, Blast_Score=265, Evalue=4e-71, Organism=Drosophila melanogaster, GI24644287, Length=310, Percent_Identity=36.4516129032258, Blast_Score=169, Evalue=5e-42, Organism=Drosophila melanogaster, GI24644289, Length=235, Percent_Identity=38.7234042553192, Blast_Score=152, Evalue=4e-37, Organism=Drosophila melanogaster, GI24642586, Length=408, Percent_Identity=25.9803921568627, Blast_Score=92, Evalue=1e-18, Organism=Drosophila melanogaster, GI18859883, Length=457, Percent_Identity=24.72647702407, Blast_Score=80, Evalue=4e-15,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR006680 - InterPro: IPR011778 - InterPro: IPR011059 [H]
Pfam domain/function: PF01979 Amidohydro_1 [H]
EC number: 3.-.-.- [C]
Molecular weight: Translated: 51016; Mature: 51016
Theoretical pI: Translated: 6.65; Mature: 6.65
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
2.4 %Cys (Translated Protein) 2.2 %Met (Translated Protein) 4.6 %Cys+Met (Translated Protein) 2.4 %Cys (Mature Protein) 2.2 %Met (Mature Protein) 4.6 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MRVLIKNGTVVNADGQAKQDLLIESGIVRQLGNNISPQLPYEEIDATGCYVFPGGVDVHT CEEEEECCEEECCCCCCHHHHHHHHHHHHHHCCCCCCCCCHHHHCCCEEEEECCCEEEEE HFNIDVGIARSCDDFFTGTRAAACGGTTTIIDHMGFGPNGCRLRHQLEVYRGYAAHKAVI EEEEEEECCCCCHHHHCCCCHHHCCCCHHHHHCCCCCCCCCCHHHHHHHHHCHHHHHEEE DYSFHGVIQHINHAILDEIPMMAEEGLSSFKLYLTYQYKLNDDEVLQALRRLHESGALTT EHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEEEEEEEEECCHHHHHHHHHHHHHCCCEEE VHPENDAAIASKRAEFIAAGLTAPRYHALSRPLECEAEAIARMINLAQIAGNAPLYIVHL ECCCCCHHHHHHHHHHHHHCCCCCHHHHHCCCCCCCHHHHHHHHHHHHHCCCCCEEEEEC SNGLGLDYLRLARANHQPVWVETCPQYLLLDERSYDTEDGMKFILSPPLRNVREQDKLWC CCCCCHHHHHHHHCCCCEEEHCCCCCEEEEECCCCCCCCCCEEEECCCHHHHHHHCCEEE GISDGAIDVVATDHCTFSMAQRLQISKGDFSRCPNGLPGVENRMQLLFSSGVMTGRITPE EECCCEEEEEEECCHHHHHHHHHCCCCCCHHHCCCCCCCHHHHHHHHHHCCCEEECCCHH RFVELTSAMPARLFGLWPQKGLLAPGSDGDVVIIDPRQSQQIQHRHLHDNADYSPWEGFT HHHHHHHCCHHHHHCCCCCCCEECCCCCCCEEEECCCCCHHHHHHHCCCCCCCCCCCCEE CQGAIVRTLSRGETIFCDGTFTGKAGRGRFLRRKPFVPPVL ECHHHHHHHCCCCEEEECCEECCCCCCCCCEECCCCCCCCC >Mature Secondary Structure MRVLIKNGTVVNADGQAKQDLLIESGIVRQLGNNISPQLPYEEIDATGCYVFPGGVDVHT CEEEEECCEEECCCCCCHHHHHHHHHHHHHHCCCCCCCCCHHHHCCCEEEEECCCEEEEE HFNIDVGIARSCDDFFTGTRAAACGGTTTIIDHMGFGPNGCRLRHQLEVYRGYAAHKAVI EEEEEEECCCCCHHHHCCCCHHHCCCCHHHHHCCCCCCCCCCHHHHHHHHHCHHHHHEEE DYSFHGVIQHINHAILDEIPMMAEEGLSSFKLYLTYQYKLNDDEVLQALRRLHESGALTT EHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEEEEEEEEECCHHHHHHHHHHHHHCCCEEE VHPENDAAIASKRAEFIAAGLTAPRYHALSRPLECEAEAIARMINLAQIAGNAPLYIVHL ECCCCCHHHHHHHHHHHHHCCCCCHHHHHCCCCCCCHHHHHHHHHHHHHCCCCCEEEEEC SNGLGLDYLRLARANHQPVWVETCPQYLLLDERSYDTEDGMKFILSPPLRNVREQDKLWC CCCCCHHHHHHHHCCCCEEEHCCCCCEEEEECCCCCCCCCCEEEECCCHHHHHHHCCEEE GISDGAIDVVATDHCTFSMAQRLQISKGDFSRCPNGLPGVENRMQLLFSSGVMTGRITPE EECCCEEEEEEECCHHHHHHHHHCCCCCCHHHCCCCCCCHHHHHHHHHHCCCEEECCCHH RFVELTSAMPARLFGLWPQKGLLAPGSDGDVVIIDPRQSQQIQHRHLHDNADYSPWEGFT HHHHHHHCCHHHHHCCCCCCCEECCCCCCCEEEECCCCCHHHHHHHCCCCCCCCCCCCEE CQGAIVRTLSRGETIFCDGTFTGKAGRGRFLRRKPFVPPVL ECHHHHHHHCCCCEEEECCEECCCCCCCCCEECCCCCCCCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: NA