Definition Methanosarcina mazei Go1 chromosome, complete genome.
Accession NC_003901
Length 4,096,345

Click here to switch to the map view.

The map label for this gene is 21226852

Identifier: 21226852

GI number: 21226852

Start: 899690

End: 901618

Strand: Direct

Name: 21226852

Synonym: MM_0750

Alternate gene names: NA

Gene position: 899690-901618 (Clockwise)

Preceding gene: 21226849

Following gene: 21226853

Centisome position: 21.96

GC content: 47.74

Gene sequence:

>1929_bases
ATGCACTATAGCCTTGGAATCGATGCCGGGGGCACTTATACAGACGCAGTACTTGTGAGGGATTCTGATGGGAAAATTGC
AGACTCAAATAAAGCACTGACTACCTATCCCGACCCACTTGCCGGCATCAAAAAGGTAATTGATGGGCTTAATCCGGAGT
ATCTCAAAAACATAAAACTCGTATCCGTATCAACCACCCTTTCCACCAATACCATACTTGAAGGGAACGGTTTTCCTGTA
GCTCTTATTCTCATCGGGGACCACCCTCTTGAAAAGGAATTCCCGACAGGGCATGTGCTTTTTGCAGGAGGAGGGCATAA
CCATAATGGAGAAGAAATATCCCCTCTTGACCTGAAAGCCATTGAAAAATTTGCCCTGAGCGTAAAGGACAAAGTATCTG
CTTTTGCTATTTCTTCCTATTTCAGTACACGCAACCCTGAACATGAGCTTAAAGCAAGAGACTGCATAATGAAACTTACA
GGACTTCCTGCGGTCTGCGGGCACGAACTCTCCCAGGAACTGGGAGCCTATGAGAGGTCAGTAACAGCTTTCCTCAATGC
CCAGCTGATCCCCATAACCAGGCAGTTTGTGAAGTCCATTATTGCAGACATGACAGAAAGGGGGATTAATGCAAGGCTTC
TTATGCTCAAATGCGACGGTTCGGTTATAGGGATAAAAGACGCCCTGCAAAGACCAATAGAAACAATCTTTTCAGGCCCT
GCAGCAAGCCTTGTGGGAGCTTCTTACCTTTCAGGGCTGCAAACCTGCGCAGTTGTTGACGTAGGTGGGACGAGCACTGA
TATTTCTTCAATTTATATGGGAGTCCCTGACCTGAGTGACGACGGAGCCATTGTCGGCGGCTGGAAGACAAGAGTCAGAG
CTATAAGAATGGAGACAACAGCTACAGGAGGAGACAGCCATGTCTGGACAGTGGACAGGGGGCTCCACCTTGGACCACGG
AGAGTTATGCCTCTTGCAGTAGCTGCAGCTCAGTATCAGGATTTTCTGAATACGCTCAAAAGGACTCCCATACCTGCCAG
AGAAGACCTGGGAGAAAATATTCAGCCTACAAAATTTTTTGTCAGGTCAGGCTATACAGCAGGTGAGATTAGCAAGGTTG
AATCTGAAGTCCTCGGCGTAATAGGAGACGAGCCTGTTTCCGTGAATGACATAAAAACCCTTATCAGAAAAGACCTCCAC
CCCCAAACCCTGGACTCCCTCATTAAAAAGAGGCTTATCCAGGCTATAGGCTTTACACCAACAGATGCTCTTCACGTGCT
CGGGGAATATACAGCCTGGAACGAAGAAGCTTCCAGAATAGGCGCAGAAAGGCTTGCAAGGCTCATGCGCATGACACCAC
ACGAGTTCTGCACCTCAGTAAAAAAGAAGGTTGCAAGGAATATGTCGCTCCATCTCCTCTCATATATCCTGCAGGGAGTC
CCGCATACGGCTATTGAGCAAATTCTGGACGGGAATTACCAGGCAAAGTTCAAGCTTGGAGTCCCTGTTGTCCTGCTCGG
AGGACCCGTGCGCTCACACAGGAAAGAACTGGAGGAATTTATAGACGCCGAAATTATTGTTCCCGAACATGCCGAGGTAG
GAAATGCTGCAGGGGCTCTTGCAGGAAAAGGCATCAAAAGAGTGGAGATCCTTATAAGGCCTGCAAGCCTGATGTCTCCT
GAGAAGGATTTCCTTGTTTTTGCACCCGGCAGCAGGCAGAGGTTCGATGTATACACAGAAGCGTTGAATGTTGCAACAGA
ACTTGGAAAAAAGCTCGTTGAAGATTATATGAAAGAATGTGGGCTCAGTGGAGACCAGGTTGAAATTTCCATTGAGAAAA
AGACCATCTCACCTGAAGGCTGGAACCATCCTCCAATGGAAACAAATCTGCTTGTAATGGGAATTGGAATGCGCAGACTC
CACGGCTGA

Upstream 100 bases:

>100_bases
AGTTAATTTTATTGTAAAAAGCTACTGCAATTCCATACTCGATTGCAGTAAACAAAAAACAGCCAAAAACAAAAACAATA
AAAAAGGAGCCATTTTTAAT

Downstream 100 bases:

>100_bases
AAGCTCGGAATGAAAAGAAAAATTAGAATCCAGAGGAAGTAAAAACCGAAAGGGGAAATAATGAGACTGTTACTGATCGC
TGATATACATGGAAATTATG

Product: dihydropyrimidinase

Products: 3-ureidopropanoate

Alternate protein names: NA

Number of amino acids: Translated: 642; Mature: 642

Protein sequence:

>642_residues
MHYSLGIDAGGTYTDAVLVRDSDGKIADSNKALTTYPDPLAGIKKVIDGLNPEYLKNIKLVSVSTTLSTNTILEGNGFPV
ALILIGDHPLEKEFPTGHVLFAGGGHNHNGEEISPLDLKAIEKFALSVKDKVSAFAISSYFSTRNPEHELKARDCIMKLT
GLPAVCGHELSQELGAYERSVTAFLNAQLIPITRQFVKSIIADMTERGINARLLMLKCDGSVIGIKDALQRPIETIFSGP
AASLVGASYLSGLQTCAVVDVGGTSTDISSIYMGVPDLSDDGAIVGGWKTRVRAIRMETTATGGDSHVWTVDRGLHLGPR
RVMPLAVAAAQYQDFLNTLKRTPIPAREDLGENIQPTKFFVRSGYTAGEISKVESEVLGVIGDEPVSVNDIKTLIRKDLH
PQTLDSLIKKRLIQAIGFTPTDALHVLGEYTAWNEEASRIGAERLARLMRMTPHEFCTSVKKKVARNMSLHLLSYILQGV
PHTAIEQILDGNYQAKFKLGVPVVLLGGPVRSHRKELEEFIDAEIIVPEHAEVGNAAGALAGKGIKRVEILIRPASLMSP
EKDFLVFAPGSRQRFDVYTEALNVATELGKKLVEDYMKECGLSGDQVEISIEKKTISPEGWNHPPMETNLLVMGIGMRRL
HG

Sequences:

>Translated_642_residues
MHYSLGIDAGGTYTDAVLVRDSDGKIADSNKALTTYPDPLAGIKKVIDGLNPEYLKNIKLVSVSTTLSTNTILEGNGFPV
ALILIGDHPLEKEFPTGHVLFAGGGHNHNGEEISPLDLKAIEKFALSVKDKVSAFAISSYFSTRNPEHELKARDCIMKLT
GLPAVCGHELSQELGAYERSVTAFLNAQLIPITRQFVKSIIADMTERGINARLLMLKCDGSVIGIKDALQRPIETIFSGP
AASLVGASYLSGLQTCAVVDVGGTSTDISSIYMGVPDLSDDGAIVGGWKTRVRAIRMETTATGGDSHVWTVDRGLHLGPR
RVMPLAVAAAQYQDFLNTLKRTPIPAREDLGENIQPTKFFVRSGYTAGEISKVESEVLGVIGDEPVSVNDIKTLIRKDLH
PQTLDSLIKKRLIQAIGFTPTDALHVLGEYTAWNEEASRIGAERLARLMRMTPHEFCTSVKKKVARNMSLHLLSYILQGV
PHTAIEQILDGNYQAKFKLGVPVVLLGGPVRSHRKELEEFIDAEIIVPEHAEVGNAAGALAGKGIKRVEILIRPASLMSP
EKDFLVFAPGSRQRFDVYTEALNVATELGKKLVEDYMKECGLSGDQVEISIEKKTISPEGWNHPPMETNLLVMGIGMRRL
HG
>Mature_642_residues
MHYSLGIDAGGTYTDAVLVRDSDGKIADSNKALTTYPDPLAGIKKVIDGLNPEYLKNIKLVSVSTTLSTNTILEGNGFPV
ALILIGDHPLEKEFPTGHVLFAGGGHNHNGEEISPLDLKAIEKFALSVKDKVSAFAISSYFSTRNPEHELKARDCIMKLT
GLPAVCGHELSQELGAYERSVTAFLNAQLIPITRQFVKSIIADMTERGINARLLMLKCDGSVIGIKDALQRPIETIFSGP
AASLVGASYLSGLQTCAVVDVGGTSTDISSIYMGVPDLSDDGAIVGGWKTRVRAIRMETTATGGDSHVWTVDRGLHLGPR
RVMPLAVAAAQYQDFLNTLKRTPIPAREDLGENIQPTKFFVRSGYTAGEISKVESEVLGVIGDEPVSVNDIKTLIRKDLH
PQTLDSLIKKRLIQAIGFTPTDALHVLGEYTAWNEEASRIGAERLARLMRMTPHEFCTSVKKKVARNMSLHLLSYILQGV
PHTAIEQILDGNYQAKFKLGVPVVLLGGPVRSHRKELEEFIDAEIIVPEHAEVGNAAGALAGKGIKRVEILIRPASLMSP
EKDFLVFAPGSRQRFDVYTEALNVATELGKKLVEDYMKECGLSGDQVEISIEKKTISPEGWNHPPMETNLLVMGIGMRRL
HG

Specific function: Unknown

COG id: COG0145

COG function: function code EQ; N-methylhydantoinase A/acetone carboxylase, beta subunit

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Belongs to the oxoprolinase family [H]

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR008040
- InterPro:   IPR002821 [H]

Pfam domain/function: PF05378 Hydant_A_N; PF01968 Hydantoinase_A [H]

EC number: 3.5.2.2

Molecular weight: Translated: 69828; Mature: 69828

Theoretical pI: Translated: 6.70; Mature: 6.70

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.9 %Cys     (Translated Protein)
2.3 %Met     (Translated Protein)
3.3 %Cys+Met (Translated Protein)
0.9 %Cys     (Mature Protein)
2.3 %Met     (Mature Protein)
3.3 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MHYSLGIDAGGTYTDAVLVRDSDGKIADSNKALTTYPDPLAGIKKVIDGLNPEYLKNIKL
CCEEEECCCCCCEEEEEEEECCCCCEECCCCCEEECCCHHHHHHHHHCCCCHHHHCCEEE
VSVSTTLSTNTILEGNGFPVALILIGDHPLEKEFPTGHVLFAGGGHNHNGEEISPLDLKA
EEEEEEECCCEEEECCCCCEEEEEECCCCCCCCCCCCEEEEECCCCCCCCCCCCCCHHHH
IEKFALSVKDKVSAFAISSYFSTRNPEHELKARDCIMKLTGLPAVCGHELSQELGAYERS
HHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHH
VTAFLNAQLIPITRQFVKSIIADMTERGINARLLMLKCDGSVIGIKDALQRPIETIFSGP
HHHHHCCEEEHHHHHHHHHHHHHHHHCCCCEEEEEEEECCCEECHHHHHHHHHHHHHCCC
AASLVGASYLSGLQTCAVVDVGGTSTDISSIYMGVPDLSDDGAIVGGWKTRVRAIRMETT
HHHHHHHHHHHHHCEEEEEECCCCCCCHHHHEECCCCCCCCCCEECCHHHEEEEEEEEEE
ATGGDSHVWTVDRGLHLGPRRVMPLAVAAAQYQDFLNTLKRTPIPAREDLGENIQPTKFF
CCCCCCEEEEECCCCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCCCHHHCCCCCCCHHHH
VRSGYTAGEISKVESEVLGVIGDEPVSVNDIKTLIRKDLHPQTLDSLIKKRLIQAIGFTP
HHCCCCCHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHCCCHHHHHHHHHHHHHHHHCCCC
TDALHVLGEYTAWNEEASRIGAERLARLMRMTPHEFCTSVKKKVARNMSLHLLSYILQGV
CHHHHHHHHHCCCCHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHCHHHHHHHHHHHCC
PHTAIEQILDGNYQAKFKLGVPVVLLGGPVRSHRKELEEFIDAEIIVPEHAEVGNAAGAL
CHHHHHHHHCCCCEEEEEECCCEEEECCCHHHHHHHHHHHHCCEEECCCCCCCCCCHHHH
AGKGIKRVEILIRPASLMSPEKDFLVFAPGSRQRFDVYTEALNVATELGKKLVEDYMKEC
HCCCCEEEEEEEECHHHCCCCCCEEEECCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHC
GLSGDQVEISIEKKTISPEGWNHPPMETNLLVMGIGMRRLHG
CCCCCEEEEEEEEEECCCCCCCCCCCCCCEEEEECCHHHHCC
>Mature Secondary Structure
MHYSLGIDAGGTYTDAVLVRDSDGKIADSNKALTTYPDPLAGIKKVIDGLNPEYLKNIKL
CCEEEECCCCCCEEEEEEEECCCCCEECCCCCEEECCCHHHHHHHHHCCCCHHHHCCEEE
VSVSTTLSTNTILEGNGFPVALILIGDHPLEKEFPTGHVLFAGGGHNHNGEEISPLDLKA
EEEEEEECCCEEEECCCCCEEEEEECCCCCCCCCCCCEEEEECCCCCCCCCCCCCCHHHH
IEKFALSVKDKVSAFAISSYFSTRNPEHELKARDCIMKLTGLPAVCGHELSQELGAYERS
HHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHH
VTAFLNAQLIPITRQFVKSIIADMTERGINARLLMLKCDGSVIGIKDALQRPIETIFSGP
HHHHHCCEEEHHHHHHHHHHHHHHHHCCCCEEEEEEEECCCEECHHHHHHHHHHHHHCCC
AASLVGASYLSGLQTCAVVDVGGTSTDISSIYMGVPDLSDDGAIVGGWKTRVRAIRMETT
HHHHHHHHHHHHHCEEEEEECCCCCCCHHHHEECCCCCCCCCCEECCHHHEEEEEEEEEE
ATGGDSHVWTVDRGLHLGPRRVMPLAVAAAQYQDFLNTLKRTPIPAREDLGENIQPTKFF
CCCCCCEEEEECCCCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCCCHHHCCCCCCCHHHH
VRSGYTAGEISKVESEVLGVIGDEPVSVNDIKTLIRKDLHPQTLDSLIKKRLIQAIGFTP
HHCCCCCHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHCCCHHHHHHHHHHHHHHHHCCCC
TDALHVLGEYTAWNEEASRIGAERLARLMRMTPHEFCTSVKKKVARNMSLHLLSYILQGV
CHHHHHHHHHCCCCHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHCHHHHHHHHHHHCC
PHTAIEQILDGNYQAKFKLGVPVVLLGGPVRSHRKELEEFIDAEIIVPEHAEVGNAAGAL
CHHHHHHHHCCCCEEEEEECCCEEEECCCHHHHHHHHHHHHCCEEECCCCCCCCCCHHHH
AGKGIKRVEILIRPASLMSPEKDFLVFAPGSRQRFDVYTEALNVATELGKKLVEDYMKEC
HCCCCEEEEEEEECHHHCCCCCCEEEECCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHC
GLSGDQVEISIEKKTISPEGWNHPPMETNLLVMGIGMRRLHG
CCCCCEEEEEEEEEECCCCCCCCCCCCCCEEEEECCHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: 5,6-dihydrouracil; H2O

Specific reaction: 5,6-dihydrouracil + H2O = 3-ureidopropanoate

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 8688087 [H]