Definition Mesorhizobium loti MAFF303099 plasmid pMLa, complete sequence.
Accession NC_002679
Length 351,911

Click here to switch to the map view.

The map label for this gene is 13488192

Identifier: 13488192

GI number: 13488192

Start: 31223

End: 32980

Strand: Direct

Name: 13488192

Synonym: mlr9031

Alternate gene names: NA

Gene position: 31223-32980 (Clockwise)

Preceding gene: 13488191

Following gene: 13488193

Centisome position: 8.87

GC content: 59.22

Gene sequence:

>1758_bases
ATGATGGCTAATCCAATCGATCCTATCACGTTTGAAGTTCTGCGTAACACGTTTGAACACGTCTGCCGCCGGATGACGGT
TATCCTCCAAAAGTCCTCCTTCTCGCCGATCCTGTCTGAGAACCTGGACTTCTCCAACGCTATCTACGATCCGACGTTGC
GCTTGGTTGGACAGACGGCCAACTGCCCGGTGCACCTCGCCGCGATGCATTTCAGCGTCCAGGCGGTGGCCAGGAAGTTC
GGCATCGAGACTTTGCGTCCTGGGGACGTGGTGATCCTCAACGACCCGTACGACGGCGGTACGCACATCAACGACGTGAC
GCTGACGATGCCTGTCTTCTACGAAAATGAGCTGATCGGCTTCGCGGTAAGTCGTGGCCACTGGATGGATCTTGGCGGAG
GTGGCCCGGGCGGGCAGGGCTTTGGTACGCATGTCGCAGGCGAAGGTCTTCGACTGCCTCCTTTGAAATTGTATCGCGAC
TACAAAGTCGATCAGGATCTGCTCGAAATCCTCCTTCGGAACACGCGAACGCCTCATTACGTCAAAGGCGACCTTCAGGC
TCACATGGGCGCGCTACTTGCCGCTGAGGACGAGCTCCGCGCGACAGCTCGTAAGTACGGTCGGGCAACTCTTATCCAAG
GAATGGGTGACATGATCGGTTACACCGAGCGCATCGTCCGGGCGGAGATCGAAAAAATTCCGGACGGCGTGTACGAAGGA
GCCGATTACGCCGATTCCGATGGCATCACCGACCAGAAGGTTTGGGTTCGCGTCAAGCTCACGGTTTCAGGGTCCAACCT
ACATGTCGATTTCGCCGGCAGCGACCCACAGGTCGCGGGCGCGATCAACTCACCATTCGCGAACACAACTGCAGCGGTGT
ACACCGCTTTACAGTTCTTCCTCGCGCCCGATGCTCCGCCCAATGCTGGGATGTTCGCTCCGATTTCGTTGAGCCTGCCG
GACGATTGTTGGCTGAATGCTCGTTGGCCTGCTCCGGTAGTCGGTTGCACGACCGTCACATCGGGCAAAGTGCAGAGCGC
CATCTGGCAAGCTGTCGCCAAAGCAATCCCGAGTCTGGCGATCGCTCCAACCTGCGCAGACGCAAATTGGTTCGTCGCCG
CTGTCCGTGGCCCAGGAAACCGTATCGATGTGTTCTCAGACATCCCTGCCGGCGGCTGGGGCGGCACGCCATACAACGAC
GGGCTAAACGTCACGCTGGATCCTCTGGGCAACTGCACAAATATGCCGGCGGAGGCAGCCGAGCTCCTCTACCCGGTGAG
AGTCGAGGCATTCGACTTGCGCCAGGATTCTGGCGGTCCGGGAGAGAACCGCGGAGGGTTGGGCGCAAGGTTCAAGTTCC
GGTTCCTGAACGGTGGCGAACTCTCGATCGAAACATCCCGTACCATTGAGGGTAGCCCGGGCGTCAACGGCGGCGGTATA
AGCCCCGTCCAGCTTCTCGTTCAAGAATACCAAGACGGTCGCCGGGAGATTATCGGCGGACCTCGTCCCGACGGAACGTG
GCGCAGCCCGCTTCTGTCCTCGCACAAATTTGGACCCGGTGAGGCCTTCGAGTTTCTGTCGACCGGAGGTGGTGGCTGGG
GCGTGGCTCAATCCCGGGACCCAGAGAGAGTTCGGCAGGACGTGATCGACGGCTATGTCTCGCTCCAAGCTGCCCGTCGC
GATTATGGGGTCGCGCTGGATCCCAACACGTTCGAACTCCTTCACGATCAAACCTCAAAGTTGAGAAACCTGGCATGA

Upstream 100 bases:

>100_bases
GCGGTCCCGCTCTCATTGAGGATCCGCATACCAGCATTGTCATTCCTCCGGGTTGGGCCGCTCGGTTTGACTCAGCTCGA
AACTGCATTCTGGAGAGGGC

Downstream 100 bases:

>100_bases
ACAACGAGATATTTATCACTTGCGCCGTAACCGGCGCTGGGCCGGGGCCGCGAAAGAACTCGAACGTTCCGGTCACTCCT
GCGCAGATCGCCGAAGACGT

Product: N-methylhydantoinase

Products: ADP; phosphate; N-carbamoylsarcosine

Alternate protein names: NA

Number of amino acids: Translated: 585; Mature: 585

Protein sequence:

>585_residues
MMANPIDPITFEVLRNTFEHVCRRMTVILQKSSFSPILSENLDFSNAIYDPTLRLVGQTANCPVHLAAMHFSVQAVARKF
GIETLRPGDVVILNDPYDGGTHINDVTLTMPVFYENELIGFAVSRGHWMDLGGGGPGGQGFGTHVAGEGLRLPPLKLYRD
YKVDQDLLEILLRNTRTPHYVKGDLQAHMGALLAAEDELRATARKYGRATLIQGMGDMIGYTERIVRAEIEKIPDGVYEG
ADYADSDGITDQKVWVRVKLTVSGSNLHVDFAGSDPQVAGAINSPFANTTAAVYTALQFFLAPDAPPNAGMFAPISLSLP
DDCWLNARWPAPVVGCTTVTSGKVQSAIWQAVAKAIPSLAIAPTCADANWFVAAVRGPGNRIDVFSDIPAGGWGGTPYND
GLNVTLDPLGNCTNMPAEAAELLYPVRVEAFDLRQDSGGPGENRGGLGARFKFRFLNGGELSIETSRTIEGSPGVNGGGI
SPVQLLVQEYQDGRREIIGGPRPDGTWRSPLLSSHKFGPGEAFEFLSTGGGGWGVAQSRDPERVRQDVIDGYVSLQAARR
DYGVALDPNTFELLHDQTSKLRNLA

Sequences:

>Translated_585_residues
MMANPIDPITFEVLRNTFEHVCRRMTVILQKSSFSPILSENLDFSNAIYDPTLRLVGQTANCPVHLAAMHFSVQAVARKF
GIETLRPGDVVILNDPYDGGTHINDVTLTMPVFYENELIGFAVSRGHWMDLGGGGPGGQGFGTHVAGEGLRLPPLKLYRD
YKVDQDLLEILLRNTRTPHYVKGDLQAHMGALLAAEDELRATARKYGRATLIQGMGDMIGYTERIVRAEIEKIPDGVYEG
ADYADSDGITDQKVWVRVKLTVSGSNLHVDFAGSDPQVAGAINSPFANTTAAVYTALQFFLAPDAPPNAGMFAPISLSLP
DDCWLNARWPAPVVGCTTVTSGKVQSAIWQAVAKAIPSLAIAPTCADANWFVAAVRGPGNRIDVFSDIPAGGWGGTPYND
GLNVTLDPLGNCTNMPAEAAELLYPVRVEAFDLRQDSGGPGENRGGLGARFKFRFLNGGELSIETSRTIEGSPGVNGGGI
SPVQLLVQEYQDGRREIIGGPRPDGTWRSPLLSSHKFGPGEAFEFLSTGGGGWGVAQSRDPERVRQDVIDGYVSLQAARR
DYGVALDPNTFELLHDQTSKLRNLA
>Mature_585_residues
MMANPIDPITFEVLRNTFEHVCRRMTVILQKSSFSPILSENLDFSNAIYDPTLRLVGQTANCPVHLAAMHFSVQAVARKF
GIETLRPGDVVILNDPYDGGTHINDVTLTMPVFYENELIGFAVSRGHWMDLGGGGPGGQGFGTHVAGEGLRLPPLKLYRD
YKVDQDLLEILLRNTRTPHYVKGDLQAHMGALLAAEDELRATARKYGRATLIQGMGDMIGYTERIVRAEIEKIPDGVYEG
ADYADSDGITDQKVWVRVKLTVSGSNLHVDFAGSDPQVAGAINSPFANTTAAVYTALQFFLAPDAPPNAGMFAPISLSLP
DDCWLNARWPAPVVGCTTVTSGKVQSAIWQAVAKAIPSLAIAPTCADANWFVAAVRGPGNRIDVFSDIPAGGWGGTPYND
GLNVTLDPLGNCTNMPAEAAELLYPVRVEAFDLRQDSGGPGENRGGLGARFKFRFLNGGELSIETSRTIEGSPGVNGGGI
SPVQLLVQEYQDGRREIIGGPRPDGTWRSPLLSSHKFGPGEAFEFLSTGGGGWGVAQSRDPERVRQDVIDGYVSLQAARR
DYGVALDPNTFELLHDQTSKLRNLA

Specific function: Unknown

COG id: COG0146

COG function: function code EQ; N-methylhydantoinase B/acetone carboxylase, alpha subunit

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Belongs to the oxoprolinase family [H]

Homologues:

Organism=Homo sapiens, GI48314820, Length=557, Percent_Identity=29.2639138240575, Blast_Score=158, Evalue=1e-38,
Organism=Caenorhabditis elegans, GI133901900, Length=564, Percent_Identity=26.5957446808511, Blast_Score=157, Evalue=1e-38,
Organism=Caenorhabditis elegans, GI133901902, Length=528, Percent_Identity=26.5151515151515, Blast_Score=137, Evalue=2e-32,
Organism=Saccharomyces cerevisiae, GI6322634, Length=563, Percent_Identity=27.5310834813499, Blast_Score=165, Evalue=2e-41,
Organism=Drosophila melanogaster, GI45550492, Length=576, Percent_Identity=29.3402777777778, Blast_Score=161, Evalue=1e-39,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR003692 [H]

Pfam domain/function: PF02538 Hydantoinase_B [H]

EC number: 3.5.2.14

Molecular weight: Translated: 63097; Mature: 63097

Theoretical pI: Translated: 5.05; Mature: 5.05

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.0 %Cys     (Translated Protein)
1.9 %Met     (Translated Protein)
2.9 %Cys+Met (Translated Protein)
1.0 %Cys     (Mature Protein)
1.9 %Met     (Mature Protein)
2.9 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MMANPIDPITFEVLRNTFEHVCRRMTVILQKSSFSPILSENLDFSNAIYDPTLRLVGQTA
CCCCCCCHHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHCCCCCCCCCCCCHHHEECCCC
NCPVHLAAMHFSVQAVARKFGIETLRPGDVVILNDPYDGGTHINDVTLTMPVFYENELIG
CCCEEEEHHHHHHHHHHHHHCCCCCCCCCEEEEECCCCCCCEECEEEEEEEEEECCCEEE
FAVSRGHWMDLGGGGPGGQGFGTHVAGEGLRLPPLKLYRDYKVDQDLLEILLRNTRTPHY
EEECCCCEEECCCCCCCCCCCCCCCCCCCCCCCCHHHHHCCCCCHHHHHHHHHCCCCCCE
VKGDLQAHMGALLAAEDELRATARKYGRATLIQGMGDMIGYTERIVRAEIEKIPDGVYEG
EECCHHHHHHHHHHCHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHCC
ADYADSDGITDQKVWVRVKLTVSGSNLHVDFAGSDPQVAGAINSPFANTTAAVYTALQFF
CCCCCCCCCCCCEEEEEEEEEEECCEEEEEECCCCCCEECCCCCCCCCHHHHHHHHHHHH
LAPDAPPNAGMFAPISLSLPDDCWLNARWPAPVVGCTTVTSGKVQSAIWQAVAKAIPSLA
CCCCCCCCCCEEEEEEECCCCCCEECCCCCCCEEEEEECCCCHHHHHHHHHHHHHCCCEE
IAPTCADANWFVAAVRGPGNRIDVFSDIPAGGWGGTPYNDGLNVTLDPLGNCTNMPAEAA
EECCCCCCCEEEEEEECCCCEEEEEECCCCCCCCCCCCCCCCEEEECCCCCCCCCCHHHH
ELLYPVRVEAFDLRQDSGGPGENRGGLGARFKFRFLNGGELSIETSRTIEGSPGVNGGGI
HHEEEEEEEEEEEECCCCCCCCCCCCCCCEEEEEEECCCEEEEEECCEECCCCCCCCCCC
SPVQLLVQEYQDGRREIIGGPRPDGTWRSPLLSSHKFGPGEAFEFLSTGGGGWGVAQSRD
CHHHHHHHHHHCCHHHHCCCCCCCCCCCCCHHHCCCCCCCHHHHHHHCCCCCCCCCCCCC
PERVRQDVIDGYVSLQAARRDYGVALDPNTFELLHDQTSKLRNLA
HHHHHHHHHHHHHHHHHHHHCCCEEECCCHHHHHHHHHHHHHCCC
>Mature Secondary Structure
MMANPIDPITFEVLRNTFEHVCRRMTVILQKSSFSPILSENLDFSNAIYDPTLRLVGQTA
CCCCCCCHHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHCCCCCCCCCCCCHHHEECCCC
NCPVHLAAMHFSVQAVARKFGIETLRPGDVVILNDPYDGGTHINDVTLTMPVFYENELIG
CCCEEEEHHHHHHHHHHHHHCCCCCCCCCEEEEECCCCCCCEECEEEEEEEEEECCCEEE
FAVSRGHWMDLGGGGPGGQGFGTHVAGEGLRLPPLKLYRDYKVDQDLLEILLRNTRTPHY
EEECCCCEEECCCCCCCCCCCCCCCCCCCCCCCCHHHHHCCCCCHHHHHHHHHCCCCCCE
VKGDLQAHMGALLAAEDELRATARKYGRATLIQGMGDMIGYTERIVRAEIEKIPDGVYEG
EECCHHHHHHHHHHCHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHCC
ADYADSDGITDQKVWVRVKLTVSGSNLHVDFAGSDPQVAGAINSPFANTTAAVYTALQFF
CCCCCCCCCCCCEEEEEEEEEEECCEEEEEECCCCCCEECCCCCCCCCHHHHHHHHHHHH
LAPDAPPNAGMFAPISLSLPDDCWLNARWPAPVVGCTTVTSGKVQSAIWQAVAKAIPSLA
CCCCCCCCCCEEEEEEECCCCCCEECCCCCCCEEEEEECCCCHHHHHHHHHHHHHCCCEE
IAPTCADANWFVAAVRGPGNRIDVFSDIPAGGWGGTPYNDGLNVTLDPLGNCTNMPAEAA
EECCCCCCCEEEEEEECCCCEEEEEECCCCCCCCCCCCCCCCEEEECCCCCCCCCCHHHH
ELLYPVRVEAFDLRQDSGGPGENRGGLGARFKFRFLNGGELSIETSRTIEGSPGVNGGGI
HHEEEEEEEEEEEECCCCCCCCCCCCCCCEEEEEEECCCEEEEEECCEECCCCCCCCCCC
SPVQLLVQEYQDGRREIIGGPRPDGTWRSPLLSSHKFGPGEAFEFLSTGGGGWGVAQSRD
CHHHHHHHHHHCCHHHHCCCCCCCCCCCCCHHHCCCCCCCHHHHHHHCCCCCCCCCCCCC
PERVRQDVIDGYVSLQAARRDYGVALDPNTFELLHDQTSKLRNLA
HHHHHHHHHHHHHHHHHHHHCCCEEECCCHHHHHHHHHHHHHCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: ATP; N-methylimidazolidine-2,4-dione; H2O

Specific reaction: ATP + N-methylimidazolidine-2,4-dione + 2 H2O = ADP + phosphate + N-carbamoylsarcosine

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 8688087 [H]