Definition Chlorobium tepidum TLS, complete genome.
Accession NC_002932
Length 2,154,946

Click here to switch to the map view.

The map label for this gene is mtnU [H]

Identifier: 21673254

GI number: 21673254

Start: 428825

End: 430384

Strand: Direct

Name: mtnU [H]

Synonym: CT0415

Alternate gene names: 21673254

Gene position: 428825-430384 (Clockwise)

Preceding gene: 21673253

Following gene: 21673255

Centisome position: 19.9

GC content: 63.97

Gene sequence:

>1560_bases
ATGGAACGACTGAATATCGCGCTTGTCCATCTGGCCGTCCGGCACGGCGAGCCGGAGCACAACCGCCGGGAGCTGATCCG
CCTCAACCGCCAGGCGGCTGAAGCTGGCGCAAGGATTATCGTGAACACCGAGCTGGCCGTCAGCGGCTACAGCTTCCGAT
CGCCGAAAGAGGTCGCCGCCGTTGCCGAACCGGTTGACGGCCCATCGGTTCAGGCGATGGCAGAAATTGCCGAAGCCGCG
GGTTGCTACATCGTGCTCGGTTATCCCGAAATCGATCCGTGCACCGGCATCTGCTACAACTCCGCCGCCGTGCTCGGCCA
GGACGGAAAGCTGGTTCTCAATTATCGCAAGGTGACTGCTGAGGCGCGGTGGGCCTGTCCCGGCTCCCACATGCAGGAGA
GCCTTTTCGAGACGCCGTGGGGCAGAGCCGCCGTGCTCATCTGCTCCGACAGTTATTACGGTCTCATTCCGAGGGCAGCT
GCCCTGCGTGGAGCCGATCTTTTGCTGGTGCCAGCCAACTGGCCTGGTGGCTCACTCGATCCGAGGGAGCTCTGGCGGGC
GCGAGCTTGCGAAAACGGCTGTGCGCTGGTAGCCTGCAACCGCACCGGCAAGGATCGCACGATGGAGTGTTACGACGCAG
TCTCTTGCGCCTATGGCGCCGATGGCTCGGTCATTGCCGAGCGCAGCTCACCTGACTCGGAGGTGTTTCATGTTGAGCTT
CCCCTTTCGCGTGGAAAGCTGCGTTCGTCGAGCCGTGAACGTTTCGCATCGAGGACGCCGGAACGGTACCGCTCGATCTA
TCTCGACATGCGTTATGCAAACGATATGACGAGCTGGCACAGCTTGCCCGAACCCGCTCCGGTGCAGGTGCACTGTCTGC
ACGAACTATACTTCGAGCCGGGCGACGTGTCGGTTCTCGACAGCCTGCTGCACGACCGCGAAAAGGCCGCGGGGCTGGTG
GTGGTGCTGCCGATGCTTCGGGTTGCCAACCGTGAGGAGGCCGTCGGCTTCCTGCTGGATGTTGCACGGGCGCATGGCGC
GGCGTTCTGCGCCGGGCTTGTGGATACGGACGGGGTGGCGGAGCTGATCTGCTGCCGCCCCGACGGCAGCGTGCATCGTC
GGTGTCCGGAGCGTGACGACTTCGTGCTGATCGATCTCGATCATCTGCGCCTGACGCTGTTGTCCAAAGAGGAGTGCCGC
CACCCGGAAGCGGTGACGGCACTCGCCAAAGAGGGGTGCGACCTGGCGGTGGTGCCCGAGACCGGATTCGACGAGGGCGA
CCGGGCCGTGCTCGGTTCCCGCTCTATCGAACAGCTTGCCATCGCGGCGTGCGGGCGCGACGTGTCGTTTATCTGCCTGC
CGCCGGTCGATCACTACCGCTGGGAGGAGGCCGTTGGCGAGGGGGTCGATGGAGCCTCCATGCTGATCGAGGTGGAAAAG
CTGCGCCGCAAGCGCTTTTACGACCGGATCGACGTTGAGCTTTTGCTTGCGCGAAACGGGCGCTCGCCAGATGCCTGCCG
GGCCGATGAAACCGGAAAGCGCGAGGAGGAAACGCCGTGA

Upstream 100 bases:

>100_bases
CAACGTACGCCGAACAGCTCGAAGCGGTCGGTTGGGGCGCTGGCCGGGAGGCACTGCTTTCACTTATCACAACCGCATGG
GCGCTGGGGTACGCCGACAA

Downstream 100 bases:

>100_bases
ACTGGCTGCTCAACATCAGTACCCACGGTTCTGATCTGGAGATTGCCGGGCCGGAGTGGAGCGAAGCGGTCTCGCTGCTC
CGGCGCACCGGCATGGACGG

Product: carbon-nitrogen hydrolase family protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 519; Mature: 519

Protein sequence:

>519_residues
MERLNIALVHLAVRHGEPEHNRRELIRLNRQAAEAGARIIVNTELAVSGYSFRSPKEVAAVAEPVDGPSVQAMAEIAEAA
GCYIVLGYPEIDPCTGICYNSAAVLGQDGKLVLNYRKVTAEARWACPGSHMQESLFETPWGRAAVLICSDSYYGLIPRAA
ALRGADLLLVPANWPGGSLDPRELWRARACENGCALVACNRTGKDRTMECYDAVSCAYGADGSVIAERSSPDSEVFHVEL
PLSRGKLRSSSRERFASRTPERYRSIYLDMRYANDMTSWHSLPEPAPVQVHCLHELYFEPGDVSVLDSLLHDREKAAGLV
VVLPMLRVANREEAVGFLLDVARAHGAAFCAGLVDTDGVAELICCRPDGSVHRRCPERDDFVLIDLDHLRLTLLSKEECR
HPEAVTALAKEGCDLAVVPETGFDEGDRAVLGSRSIEQLAIAACGRDVSFICLPPVDHYRWEEAVGEGVDGASMLIEVEK
LRRKRFYDRIDVELLLARNGRSPDACRADETGKREEETP

Sequences:

>Translated_519_residues
MERLNIALVHLAVRHGEPEHNRRELIRLNRQAAEAGARIIVNTELAVSGYSFRSPKEVAAVAEPVDGPSVQAMAEIAEAA
GCYIVLGYPEIDPCTGICYNSAAVLGQDGKLVLNYRKVTAEARWACPGSHMQESLFETPWGRAAVLICSDSYYGLIPRAA
ALRGADLLLVPANWPGGSLDPRELWRARACENGCALVACNRTGKDRTMECYDAVSCAYGADGSVIAERSSPDSEVFHVEL
PLSRGKLRSSSRERFASRTPERYRSIYLDMRYANDMTSWHSLPEPAPVQVHCLHELYFEPGDVSVLDSLLHDREKAAGLV
VVLPMLRVANREEAVGFLLDVARAHGAAFCAGLVDTDGVAELICCRPDGSVHRRCPERDDFVLIDLDHLRLTLLSKEECR
HPEAVTALAKEGCDLAVVPETGFDEGDRAVLGSRSIEQLAIAACGRDVSFICLPPVDHYRWEEAVGEGVDGASMLIEVEK
LRRKRFYDRIDVELLLARNGRSPDACRADETGKREEETP
>Mature_519_residues
MERLNIALVHLAVRHGEPEHNRRELIRLNRQAAEAGARIIVNTELAVSGYSFRSPKEVAAVAEPVDGPSVQAMAEIAEAA
GCYIVLGYPEIDPCTGICYNSAAVLGQDGKLVLNYRKVTAEARWACPGSHMQESLFETPWGRAAVLICSDSYYGLIPRAA
ALRGADLLLVPANWPGGSLDPRELWRARACENGCALVACNRTGKDRTMECYDAVSCAYGADGSVIAERSSPDSEVFHVEL
PLSRGKLRSSSRERFASRTPERYRSIYLDMRYANDMTSWHSLPEPAPVQVHCLHELYFEPGDVSVLDSLLHDREKAAGLV
VVLPMLRVANREEAVGFLLDVARAHGAAFCAGLVDTDGVAELICCRPDGSVHRRCPERDDFVLIDLDHLRLTLLSKEECR
HPEAVTALAKEGCDLAVVPETGFDEGDRAVLGSRSIEQLAIAACGRDVSFICLPPVDHYRWEEAVGEGVDGASMLIEVEK
LRRKRFYDRIDVELLLARNGRSPDACRADETGKREEETP

Specific function: May be involved in a regulatory step in the methylthioribose (MTR) recycling pathway [H]

COG id: COG0388

COG function: function code R; Predicted amidohydrolase

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Contains 1 CN hydrolase domain [H]

Homologues:

Organism=Homo sapiens, GI9910460, Length=251, Percent_Identity=27.4900398406374, Blast_Score=76, Evalue=1e-13,
Organism=Saccharomyces cerevisiae, GI6322522, Length=157, Percent_Identity=29.2993630573248, Blast_Score=72, Evalue=2e-13,
Organism=Saccharomyces cerevisiae, GI6323383, Length=219, Percent_Identity=27.8538812785388, Blast_Score=68, Evalue=3e-12,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR003010 [H]

Pfam domain/function: PF00795 CN_hydrolase [H]

EC number: NA

Molecular weight: Translated: 57080; Mature: 57080

Theoretical pI: Translated: 5.08; Mature: 5.08

Prosite motif: PS50263 CN_HYDROLASE

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

3.9 %Cys     (Translated Protein)
1.5 %Met     (Translated Protein)
5.4 %Cys+Met (Translated Protein)
3.9 %Cys     (Mature Protein)
1.5 %Met     (Mature Protein)
5.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MERLNIALVHLAVRHGEPEHNRRELIRLNRQAAEAGARIIVNTELAVSGYSFRSPKEVAA
CCCCEEEEEEEEECCCCCCHHHHHHHHHHHHHHHCCCEEEEEEEEEECCCCCCCCHHHHH
VAEPVDGPSVQAMAEIAEAAGCYIVLGYPEIDPCTGICYNSAAVLGQDGKLVLNYRKVTA
HHCCCCCCHHHHHHHHHHHCCCEEEEECCCCCCCCCEEECCEEEECCCCCEEEEEEEECC
EARWACPGSHMQESLFETPWGRAAVLICSDSYYGLIPRAAALRGADLLLVPANWPGGSLD
CCEECCCCHHHHHHHHHCCCCCEEEEEECCCCCCCCCHHHHHCCCCEEEEECCCCCCCCC
PRELWRARACENGCALVACNRTGKDRTMECYDAVSCAYGADGSVIAERSSPDSEVFHVEL
HHHHHHHHHCCCCCEEEEECCCCCCCHHHHHHHHHHHCCCCCCEEEECCCCCCEEEEEEE
PLSRGKLRSSSRERFASRTPERYRSIYLDMRYANDMTSWHSLPEPAPVQVHCLHELYFEP
CCCCCCCCCHHHHHHHHCCCHHHHEEEEEEEECCCCHHHHCCCCCCCEEEEEEHHHHCCC
GDVSVLDSLLHDREKAAGLVVVLPMLRVANREEAVGFLLDVARAHGAAFCAGLVDTDGVA
CCHHHHHHHHHHHHHHCCEEEEEHHHHHCCHHHHHHHHHHHHHHCCCEEEECCCCCCCCE
ELICCRPDGSVHRRCPERDDFVLIDLDHLRLTLLSKEECRHPEAVTALAKEGCDLAVVPE
EEEEECCCCHHHHCCCCCCCEEEEEECCEEEEEECHHHHCCHHHHHHHHHCCCCEEEECC
TGFDEGDRAVLGSRSIEQLAIAACGRDVSFICLPPVDHYRWEEAVGEGVDGASMLIEVEK
CCCCCCCCEEECCCCHHHHHHHHCCCCCEEEEECCCHHHHHHHHHCCCCCCHHHHHHHHH
LRRKRFYDRIDVELLLARNGRSPDACRADETGKREEETP
HHHHHHHHHCCEEEEEECCCCCCCCCCCCCCCCCCCCCC
>Mature Secondary Structure
MERLNIALVHLAVRHGEPEHNRRELIRLNRQAAEAGARIIVNTELAVSGYSFRSPKEVAA
CCCCEEEEEEEEECCCCCCHHHHHHHHHHHHHHHCCCEEEEEEEEEECCCCCCCCHHHHH
VAEPVDGPSVQAMAEIAEAAGCYIVLGYPEIDPCTGICYNSAAVLGQDGKLVLNYRKVTA
HHCCCCCCHHHHHHHHHHHCCCEEEEECCCCCCCCCEEECCEEEECCCCCEEEEEEEECC
EARWACPGSHMQESLFETPWGRAAVLICSDSYYGLIPRAAALRGADLLLVPANWPGGSLD
CCEECCCCHHHHHHHHHCCCCCEEEEEECCCCCCCCCHHHHHCCCCEEEEECCCCCCCCC
PRELWRARACENGCALVACNRTGKDRTMECYDAVSCAYGADGSVIAERSSPDSEVFHVEL
HHHHHHHHHCCCCCEEEEECCCCCCCHHHHHHHHHHHCCCCCCEEEECCCCCCEEEEEEE
PLSRGKLRSSSRERFASRTPERYRSIYLDMRYANDMTSWHSLPEPAPVQVHCLHELYFEP
CCCCCCCCCHHHHHHHHCCCHHHHEEEEEEEECCCCHHHHCCCCCCCEEEEEEHHHHCCC
GDVSVLDSLLHDREKAAGLVVVLPMLRVANREEAVGFLLDVARAHGAAFCAGLVDTDGVA
CCHHHHHHHHHHHHHHCCEEEEEHHHHHCCHHHHHHHHHHHHHHCCCEEEECCCCCCCCE
ELICCRPDGSVHRRCPERDDFVLIDLDHLRLTLLSKEECRHPEAVTALAKEGCDLAVVPE
EEEEECCCCHHHHCCCCCCCEEEEEECCEEEEEECHHHHCCHHHHHHHHHCCCCEEEECC
TGFDEGDRAVLGSRSIEQLAIAACGRDVSFICLPPVDHYRWEEAVGEGVDGASMLIEVEK
CCCCCCCCEEECCCCHHHHHHHHCCCCCEEEEECCCHHHHHHHHHCCCCCCHHHHHHHHH
LRRKRFYDRIDVELLLARNGRSPDACRADETGKREEETP
HHHHHHHHHCCEEEEEECCCCCCCCCCCCCCCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 9384377; 12022921 [H]