Definition Methanosarcina mazei Go1 chromosome, complete genome.
Accession NC_003901
Length 4,096,345

Click here to switch to the map view.

The map label for this gene is 21226169

Identifier: 21226169

GI number: 21226169

Start: 89713

End: 91257

Strand: Reverse

Name: 21226169

Synonym: MM_0067

Alternate gene names: NA

Gene position: 91257-89713 (Counterclockwise)

Preceding gene: 21226170

Following gene: 21226168

Centisome position: 2.23

GC content: 48.09

Gene sequence:

>1545_bases
ATGAAACTCGGGATCGGGAAGATTAAGGATGTACTCAAAAGCGGAGCCGGAAAAAGTACCGAATCCGGGAGAGAAGAACA
AAAAATAGAGGAAATTGAGCCTGATAGGGTGGAGGAAGCTACAATGACTGCAAAAATTTCAGAGCAGGAATCAGAAAATA
CACCCGACAAGGAACATCTGGTTCCAATGAACAGGACAGAATGTAAAAAAACAGGTCTTATTTTCTTCCCCGCTTTTGAC
TGGGCAATTTCCCCAACCCACCCGGAAAGGGAGGAACGTCTCCTCTATACCAGGGACCAGATCTTTGAAGAAGGGCTGAT
GGATCTCCCGCAGATAGCAGAGTACAAGCCGCGTCTTGCAGAGTTTAAGGACATTGCAAGGGTCCATTTCTGTATCCCGG
ACATAGAAGCTCAGGCTACAACCCCACATCTGATTGCGGCTGGCAGCTGTCTTGTACTTGCCGATGCCCTCATGCGAGGA
GAAGTTAAAAACGCTTTCGCCCTCGTCCGCCCTCCGGGCCACCACGCCATGACAGTGGCTCACGGAAACCGCGGTTTTTG
CAATATCAATAATGAAGCAATCCTTGTAGAGTACCTGAGAAAAAAATACGGGATCCGCAGGATCGCAATTGTGGACACCG
ACGTCCATCACGGGGACGGGACACAGGAGATTTTTTACAATGACCCGGACATACTTTTTATTTCTTTCCACCAGGACGGG
AGGACACTCTATCCAGGATCCGGTTTTACGAACGAACTGGGAGGCCCGAAAGCCCTGGGCAGGACAATAAATATTCCTCT
TCCTCCGGGGACTCCGGATGAGGGCATACTCTACGTTCTTGATTCTCTGGTGATGCCCATCCTCGAGGACTTCAAACCCG
AGCTTGTCCTCAATTCTGCAGGGCAGGACAACCATTATACAGATCCTCTCGCAAACATGCGTTTTTCCGCACAGGGCTAT
GCAAAACTGAATGAAAAACTTGGACCTGATATGGCAGTTCTTGAAGGGGGCTATGCGATCCAGAGTGCTCTGCCTTATGT
AAATACAGGAATAATCCTTGCCATGGCAGGGCTTGATTATTCCTGCGTAATGGAGCCCGATTTCAAGCCCGGGATGTTTG
TGCAGGCTGCAAGGGACAGGCAGATACTGGAAGGGGTTGTTGCAACCCAGCTGGAAAACTGGAAAAACCGGAACAGGCTT
GTAGAAGAAGAGATCGCAAAACATGGGGACTTTTACCGCCGGAAAAAACAGATCTTCTACGATACCGATATGATTCAGGA
AGTCCAGGAAGAAACAATCAAAATGTGCCCTGACTGCCAGGGTTATGTAACCATAGACTCGCGTGCTCACAGAAGCATAA
ACGACACAAGGATATTCGGAGTTTCAGTCCCTATCTATGCATGCAATCGCTGCCAGGCAGAAGCGGAGGAGGAATACAAA
AAGAGACTCAAATCTCCAGAATATGAATATGTCTACCTTCAGGATAAGAAAGCAGATGAATACAGGGCATACAATATGAG
AACAAAACAGGAGATAGTCTACTGA

Upstream 100 bases:

>100_bases
TTAACATAGTGGAAGGCTGGCTTACTGTGGGGAGGCTTTTTGACGTAAGTATGCAGATCCCGGCAGGCCTCATTCCAGAA
TGGAGCAGGAGGGAAAAGGC

Downstream 100 bases:

>100_bases
AAAACCGTTTAAAGCAGCCTGTATAAAGGCCTGCAATAATTTTGAATAAATTTTTTAGAATCACTTTCTTTTTTTAGGAT
TACTTTCTTTTTTTTAGAAT

Product: hypothetical protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 514; Mature: 514

Protein sequence:

>514_residues
MKLGIGKIKDVLKSGAGKSTESGREEQKIEEIEPDRVEEATMTAKISEQESENTPDKEHLVPMNRTECKKTGLIFFPAFD
WAISPTHPEREERLLYTRDQIFEEGLMDLPQIAEYKPRLAEFKDIARVHFCIPDIEAQATTPHLIAAGSCLVLADALMRG
EVKNAFALVRPPGHHAMTVAHGNRGFCNINNEAILVEYLRKKYGIRRIAIVDTDVHHGDGTQEIFYNDPDILFISFHQDG
RTLYPGSGFTNELGGPKALGRTINIPLPPGTPDEGILYVLDSLVMPILEDFKPELVLNSAGQDNHYTDPLANMRFSAQGY
AKLNEKLGPDMAVLEGGYAIQSALPYVNTGIILAMAGLDYSCVMEPDFKPGMFVQAARDRQILEGVVATQLENWKNRNRL
VEEEIAKHGDFYRRKKQIFYDTDMIQEVQEETIKMCPDCQGYVTIDSRAHRSINDTRIFGVSVPIYACNRCQAEAEEEYK
KRLKSPEYEYVYLQDKKADEYRAYNMRTKQEIVY

Sequences:

>Translated_514_residues
MKLGIGKIKDVLKSGAGKSTESGREEQKIEEIEPDRVEEATMTAKISEQESENTPDKEHLVPMNRTECKKTGLIFFPAFD
WAISPTHPEREERLLYTRDQIFEEGLMDLPQIAEYKPRLAEFKDIARVHFCIPDIEAQATTPHLIAAGSCLVLADALMRG
EVKNAFALVRPPGHHAMTVAHGNRGFCNINNEAILVEYLRKKYGIRRIAIVDTDVHHGDGTQEIFYNDPDILFISFHQDG
RTLYPGSGFTNELGGPKALGRTINIPLPPGTPDEGILYVLDSLVMPILEDFKPELVLNSAGQDNHYTDPLANMRFSAQGY
AKLNEKLGPDMAVLEGGYAIQSALPYVNTGIILAMAGLDYSCVMEPDFKPGMFVQAARDRQILEGVVATQLENWKNRNRL
VEEEIAKHGDFYRRKKQIFYDTDMIQEVQEETIKMCPDCQGYVTIDSRAHRSINDTRIFGVSVPIYACNRCQAEAEEEYK
KRLKSPEYEYVYLQDKKADEYRAYNMRTKQEIVY
>Mature_514_residues
MKLGIGKIKDVLKSGAGKSTESGREEQKIEEIEPDRVEEATMTAKISEQESENTPDKEHLVPMNRTECKKTGLIFFPAFD
WAISPTHPEREERLLYTRDQIFEEGLMDLPQIAEYKPRLAEFKDIARVHFCIPDIEAQATTPHLIAAGSCLVLADALMRG
EVKNAFALVRPPGHHAMTVAHGNRGFCNINNEAILVEYLRKKYGIRRIAIVDTDVHHGDGTQEIFYNDPDILFISFHQDG
RTLYPGSGFTNELGGPKALGRTINIPLPPGTPDEGILYVLDSLVMPILEDFKPELVLNSAGQDNHYTDPLANMRFSAQGY
AKLNEKLGPDMAVLEGGYAIQSALPYVNTGIILAMAGLDYSCVMEPDFKPGMFVQAARDRQILEGVVATQLENWKNRNRL
VEEEIAKHGDFYRRKKQIFYDTDMIQEVQEETIKMCPDCQGYVTIDSRAHRSINDTRIFGVSVPIYACNRCQAEAEEEYK
KRLKSPEYEYVYLQDKKADEYRAYNMRTKQEIVY

Specific function: Putative deacetylase [H]

COG id: COG0123

COG function: function code BQ; Deacetylases, including yeast histone deacetylase and acetoin utilization protein

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Belongs to the histone deacetylase family [H]

Homologues:

Organism=Homo sapiens, GI30795202, Length=206, Percent_Identity=41.747572815534, Blast_Score=147, Evalue=3e-35,
Organism=Homo sapiens, GI30795204, Length=206, Percent_Identity=41.747572815534, Blast_Score=147, Evalue=3e-35,
Organism=Homo sapiens, GI17158039, Length=206, Percent_Identity=41.747572815534, Blast_Score=146, Evalue=4e-35,
Organism=Homo sapiens, GI13128864, Length=291, Percent_Identity=32.6460481099656, Blast_Score=140, Evalue=3e-33,
Organism=Homo sapiens, GI20070354, Length=211, Percent_Identity=40.2843601895735, Blast_Score=140, Evalue=3e-33,
Organism=Homo sapiens, GI148539870, Length=268, Percent_Identity=35.4477611940299, Blast_Score=137, Evalue=3e-32,
Organism=Homo sapiens, GI169234807, Length=270, Percent_Identity=35.5555555555556, Blast_Score=136, Evalue=4e-32,
Organism=Homo sapiens, GI153085395, Length=206, Percent_Identity=37.378640776699, Blast_Score=135, Evalue=7e-32,
Organism=Homo sapiens, GI62750347, Length=263, Percent_Identity=33.8403041825095, Blast_Score=131, Evalue=2e-30,
Organism=Homo sapiens, GI62750349, Length=263, Percent_Identity=33.8403041825095, Blast_Score=131, Evalue=2e-30,
Organism=Homo sapiens, GI226529806, Length=221, Percent_Identity=34.841628959276, Blast_Score=109, Evalue=5e-24,
Organism=Homo sapiens, GI13128860, Length=163, Percent_Identity=30.0613496932515, Blast_Score=87, Evalue=3e-17,
Organism=Homo sapiens, GI13128862, Length=354, Percent_Identity=24.0112994350282, Blast_Score=86, Evalue=6e-17,
Organism=Homo sapiens, GI293336691, Length=264, Percent_Identity=25, Blast_Score=86, Evalue=1e-16,
Organism=Homo sapiens, GI8923769, Length=215, Percent_Identity=28.3720930232558, Blast_Score=85, Evalue=2e-16,
Organism=Homo sapiens, GI262073088, Length=177, Percent_Identity=29.3785310734463, Blast_Score=83, Evalue=6e-16,
Organism=Caenorhabditis elegans, GI193209491, Length=226, Percent_Identity=35.8407079646018, Blast_Score=132, Evalue=6e-31,
Organism=Caenorhabditis elegans, GI17540334, Length=208, Percent_Identity=35.0961538461538, Blast_Score=124, Evalue=9e-29,
Organism=Caenorhabditis elegans, GI193206283, Length=208, Percent_Identity=35.0961538461538, Blast_Score=124, Evalue=1e-28,
Organism=Caenorhabditis elegans, GI17540332, Length=208, Percent_Identity=35.0961538461538, Blast_Score=124, Evalue=1e-28,
Organism=Caenorhabditis elegans, GI25154020, Length=204, Percent_Identity=35.2941176470588, Blast_Score=113, Evalue=3e-25,
Organism=Caenorhabditis elegans, GI25154022, Length=204, Percent_Identity=34.8039215686275, Blast_Score=108, Evalue=9e-24,
Organism=Caenorhabditis elegans, GI17537347, Length=304, Percent_Identity=28.9473684210526, Blast_Score=90, Evalue=2e-18,
Organism=Caenorhabditis elegans, GI17534739, Length=198, Percent_Identity=30.8080808080808, Blast_Score=89, Evalue=5e-18,
Organism=Caenorhabditis elegans, GI17508561, Length=203, Percent_Identity=28.0788177339901, Blast_Score=85, Evalue=9e-17,
Organism=Caenorhabditis elegans, GI17561978, Length=199, Percent_Identity=28.1407035175879, Blast_Score=80, Evalue=2e-15,
Organism=Saccharomyces cerevisiae, GI6324307, Length=209, Percent_Identity=35.8851674641148, Blast_Score=125, Evalue=1e-29,
Organism=Saccharomyces cerevisiae, GI6321244, Length=167, Percent_Identity=32.9341317365269, Blast_Score=91, Evalue=4e-19,
Organism=Saccharomyces cerevisiae, GI6323999, Length=204, Percent_Identity=28.921568627451, Blast_Score=83, Evalue=1e-16,
Organism=Saccharomyces cerevisiae, GI6325325, Length=150, Percent_Identity=30, Blast_Score=74, Evalue=6e-14,
Organism=Drosophila melanogaster, GI24642144, Length=207, Percent_Identity=39.1304347826087, Blast_Score=138, Evalue=8e-33,
Organism=Drosophila melanogaster, GI24642142, Length=207, Percent_Identity=39.1304347826087, Blast_Score=138, Evalue=8e-33,
Organism=Drosophila melanogaster, GI24642146, Length=207, Percent_Identity=39.1304347826087, Blast_Score=138, Evalue=8e-33,
Organism=Drosophila melanogaster, GI281360899, Length=207, Percent_Identity=39.1304347826087, Blast_Score=137, Evalue=2e-32,
Organism=Drosophila melanogaster, GI281360799, Length=216, Percent_Identity=38.8888888888889, Blast_Score=134, Evalue=1e-31,
Organism=Drosophila melanogaster, GI24641720, Length=216, Percent_Identity=38.8888888888889, Blast_Score=134, Evalue=1e-31,
Organism=Drosophila melanogaster, GI281360801, Length=216, Percent_Identity=38.8888888888889, Blast_Score=134, Evalue=1e-31,
Organism=Drosophila melanogaster, GI24644244, Length=356, Percent_Identity=25.2808988764045, Blast_Score=97, Evalue=3e-20,
Organism=Drosophila melanogaster, GI24657891, Length=197, Percent_Identity=30.4568527918782, Blast_Score=89, Evalue=9e-18,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR000286
- InterPro:   IPR003084 [H]

Pfam domain/function: PF00850 Hist_deacetyl [H]

EC number: NA

Molecular weight: Translated: 58259; Mature: 58259

Theoretical pI: Translated: 5.09; Mature: 5.09

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.8 %Cys     (Translated Protein)
2.9 %Met     (Translated Protein)
4.7 %Cys+Met (Translated Protein)
1.8 %Cys     (Mature Protein)
2.9 %Met     (Mature Protein)
4.7 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKLGIGKIKDVLKSGAGKSTESGREEQKIEEIEPDRVEEATMTAKISEQESENTPDKEHL
CCCCHHHHHHHHHCCCCCCCCCCCHHHHHHHCCCCHHHHHHHHEEECHHHCCCCCCHHHC
VPMNRTECKKTGLIFFPAFDWAISPTHPEREERLLYTRDQIFEEGLMDLPQIAEYKPRLA
CCCCHHHHHHCCEEEEECCCCEECCCCCCHHHHHHHHHHHHHHHHHHCCHHHHHCCCHHH
EFKDIARVHFCIPDIEAQATTPHLIAAGSCLVLADALMRGEVKNAFALVRPPGHHAMTVA
HHHHHHHHEEECCCCCCCCCCCCEEECCCHHHHHHHHHHCCHHCCEEEECCCCCCEEEEE
HGNRGFCNINNEAILVEYLRKKYGIRRIAIVDTDVHHGDGTQEIFYNDPDILFISFHQDG
ECCCCEEEECCCCHHHHHHHHHHCCEEEEEEECCCCCCCCCCEEEECCCCEEEEEEECCC
RTLYPGSGFTNELGGPKALGRTINIPLPPGTPDEGILYVLDSLVMPILEDFKPELVLNSA
CEECCCCCCCCCCCCHHHCCCEEEECCCCCCCCCHHHHHHHHHHHHHHHCCCCCEEEECC
GQDNHYTDPLANMRFSAQGYAKLNEKLGPDMAVLEGGYAIQSALPYVNTGIILAMAGLDY
CCCCCCCCCHHCCEECCCHHHHHHHHCCCCCEEEECCHHHHHCCCCCCCCEEEEEECCCE
SCVMEPDFKPGMFVQAARDRQILEGVVATQLENWKNRNRLVEEEIAKHGDFYRRKKQIFY
EEEECCCCCCCCEEEEHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHEE
DTDMIQEVQEETIKMCPDCQGYVTIDSRAHRSINDTRIFGVSVPIYACNRCQAEAEEEYK
CHHHHHHHHHHHHHHCCCCCCEEEECCCCCCCCCCCEEEEEECCHHCCCCCCHHHHHHHH
KRLKSPEYEYVYLQDKKADEYRAYNMRTKQEIVY
HHHCCCCEEEEEEECCCCCHHHHHCCCCHHHCCC
>Mature Secondary Structure
MKLGIGKIKDVLKSGAGKSTESGREEQKIEEIEPDRVEEATMTAKISEQESENTPDKEHL
CCCCHHHHHHHHHCCCCCCCCCCCHHHHHHHCCCCHHHHHHHHEEECHHHCCCCCCHHHC
VPMNRTECKKTGLIFFPAFDWAISPTHPEREERLLYTRDQIFEEGLMDLPQIAEYKPRLA
CCCCHHHHHHCCEEEEECCCCEECCCCCCHHHHHHHHHHHHHHHHHHCCHHHHHCCCHHH
EFKDIARVHFCIPDIEAQATTPHLIAAGSCLVLADALMRGEVKNAFALVRPPGHHAMTVA
HHHHHHHHEEECCCCCCCCCCCCEEECCCHHHHHHHHHHCCHHCCEEEECCCCCCEEEEE
HGNRGFCNINNEAILVEYLRKKYGIRRIAIVDTDVHHGDGTQEIFYNDPDILFISFHQDG
ECCCCEEEECCCCHHHHHHHHHHCCEEEEEEECCCCCCCCCCEEEECCCCEEEEEEECCC
RTLYPGSGFTNELGGPKALGRTINIPLPPGTPDEGILYVLDSLVMPILEDFKPELVLNSA
CEECCCCCCCCCCCCHHHCCCEEEECCCCCCCCCHHHHHHHHHHHHHHHCCCCCEEEECC
GQDNHYTDPLANMRFSAQGYAKLNEKLGPDMAVLEGGYAIQSALPYVNTGIILAMAGLDY
CCCCCCCCCHHCCEECCCHHHHHHHHCCCCCEEEECCHHHHHCCCCCCCCEEEEEECCCE
SCVMEPDFKPGMFVQAARDRQILEGVVATQLENWKNRNRLVEEEIAKHGDFYRRKKQIFY
EEEECCCCCCCCEEEEHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHEE
DTDMIQEVQEETIKMCPDCQGYVTIDSRAHRSINDTRIFGVSVPIYACNRCQAEAEEEYK
CHHHHHHHHHHHHHHCCCCCCEEEECCCCCCCCCCCEEEEEECCHHCCCCCCHHHHHHHH
KRLKSPEYEYVYLQDKKADEYRAYNMRTKQEIVY
HHHCCCCEEEEEEECCCCCHHHHHCCCCHHHCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 9389475 [H]