The gene/protein map for NC_003901 is currently unavailable.
Definition Methanosarcina mazei Go1 chromosome, complete genome.
Accession NC_003901
Length 4,096,345

Click here to switch to the map view.

The map label for this gene is dbh1

Identifier: 21226988

GI number: 21226988

Start: 1045583

End: 1046680

Strand: Reverse

Name: dbh1

Synonym: MM_0886

Alternate gene names: 21226988

Gene position: 1046680-1045583 (Counterclockwise)

Preceding gene: 21226991

Following gene: 21226987

Centisome position: 25.55

GC content: 46.63

Gene sequence:

>1098_bases
TTGATGCAGCGGGTCGTCCTTCACATAGATATGGATTATTTTTTTGCAGCAATTGAGGAGCGGGAAAATCCGGAGCTTCG
CGAAAAAGCAGTTGTAGTCTGCATGCTCTCAGGGCGGAGCGAACTGAGCGGGTCTGTAAGCACATGCAATTACGTTGCCC
GAGAATTTGGAATCAGGTCAGGAATGCCCTGCTCAAGGGCTAAGAAACTCAATCCTGAAGCTGTTTTCCTTCCAGTCAGA
AAAGATTTCTACACCTCGGTTTCGGATAGGATTATGGAAATCCTCCGCAGCTATGCAGACCCTGGAAACGGAGATTCTTT
CGAACAGATAAGTGTTGACGAGGCATTCCTTGAGAGCTCAGAAAGGACAGGTGGAGACTTTAGGCTTGCTTTTGAGGTCG
GGATGCAGATTAAAAAGGAAATTAAAGAAAAAGAAAACCTGACATGCTCCATAGGTATAGGTCCGAATAAGTTAATTTCC
AAAATGGCTTCTTCCGCAAAAAAGCCTGATGGGATAACTGTCGTGAGCCCGCAGGACCTGGAAGCTTTCCTCTGGCCGTT
AAACGTATCAAAGCTCTGGGGGATCGGGAGTGTAACTGCAGGAAAATTGCAGGAAATGGGCATAGTTACGGTAAAGGACC
TTGCAGAACGGGACGTTATTGAACTTATTTCCATCTTCGGAAAATCAAGGGGCACCTGGCTTAAACAGGCAGCTTCGGGT
ATTGATGATTCTCCCCTTAAAGAAAGAGACGGCTCGGAGCAGATCGGGAGGATTGCAACACTGCCCGAAGATAGCCTGGA
TAAAAAGCTGATCTCTTCACTGATCGAGAGGCTAGCAGGGGATGTTATCGAAAAACTGGATTCAAGGGAACTCTCCTTCA
GGATTGTGACCGTTACGGTCATAAACTCAAATTTCAGGATGTACACAAAGAGCCGTACACTGAGCCACCCGGTATCTTCA
AAAGAAGTCCTCCTTCAGGTCTCCGGAGAAATTCTGGATGAATTCCTTTCAGAAAACAGGACTGAGTTCAGGCGAGTGGG
AGTAAGGGTGGGAGGTCTCCAGAAGAAAAAAGGTCAGAAAAGCCTTTTTGATTACTGA

Upstream 100 bases:

>100_bases
GTATTTTATTTTCCTATCTTTCTTTCACCTTTCTCGCTTTAAGCTTTAATGACAGATACTCCGAGAGATAATTATACAAA
TCTTCCCAGCATCTTTTCTT

Downstream 100 bases:

>100_bases
GGAAGATGTTTGAGTCTTGAAATTAGTTTATTTTTGAAATTATTTTTTTCTTAAAAATTATGTTTATCCTGGAAATCATG
TTTATCTTATTGAGAGTGGA

Product: DNA polymerase IV

Products: NA

Alternate protein names: Pol IV 1

Number of amino acids: Translated: 365; Mature: 365

Protein sequence:

>365_residues
MMQRVVLHIDMDYFFAAIEERENPELREKAVVVCMLSGRSELSGSVSTCNYVAREFGIRSGMPCSRAKKLNPEAVFLPVR
KDFYTSVSDRIMEILRSYADPGNGDSFEQISVDEAFLESSERTGGDFRLAFEVGMQIKKEIKEKENLTCSIGIGPNKLIS
KMASSAKKPDGITVVSPQDLEAFLWPLNVSKLWGIGSVTAGKLQEMGIVTVKDLAERDVIELISIFGKSRGTWLKQAASG
IDDSPLKERDGSEQIGRIATLPEDSLDKKLISSLIERLAGDVIEKLDSRELSFRIVTVTVINSNFRMYTKSRTLSHPVSS
KEVLLQVSGEILDEFLSENRTEFRRVGVRVGGLQKKKGQKSLFDY

Sequences:

>Translated_365_residues
MMQRVVLHIDMDYFFAAIEERENPELREKAVVVCMLSGRSELSGSVSTCNYVAREFGIRSGMPCSRAKKLNPEAVFLPVR
KDFYTSVSDRIMEILRSYADPGNGDSFEQISVDEAFLESSERTGGDFRLAFEVGMQIKKEIKEKENLTCSIGIGPNKLIS
KMASSAKKPDGITVVSPQDLEAFLWPLNVSKLWGIGSVTAGKLQEMGIVTVKDLAERDVIELISIFGKSRGTWLKQAASG
IDDSPLKERDGSEQIGRIATLPEDSLDKKLISSLIERLAGDVIEKLDSRELSFRIVTVTVINSNFRMYTKSRTLSHPVSS
KEVLLQVSGEILDEFLSENRTEFRRVGVRVGGLQKKKGQKSLFDY
>Mature_365_residues
MMQRVVLHIDMDYFFAAIEERENPELREKAVVVCMLSGRSELSGSVSTCNYVAREFGIRSGMPCSRAKKLNPEAVFLPVR
KDFYTSVSDRIMEILRSYADPGNGDSFEQISVDEAFLESSERTGGDFRLAFEVGMQIKKEIKEKENLTCSIGIGPNKLIS
KMASSAKKPDGITVVSPQDLEAFLWPLNVSKLWGIGSVTAGKLQEMGIVTVKDLAERDVIELISIFGKSRGTWLKQAASG
IDDSPLKERDGSEQIGRIATLPEDSLDKKLISSLIERLAGDVIEKLDSRELSFRIVTVTVINSNFRMYTKSRTLSHPVSS
KEVLLQVSGEILDEFLSENRTEFRRVGVRVGGLQKKKGQKSLFDY

Specific function: Poorly processive, error-prone DNA polymerase involved in untargeted mutagenesis. Copies undamaged DNA at stalled replication forks, which arise in vivo from mismatched or misaligned primer ends. These misaligned primers can be extended by polIV. Exhibits

COG id: COG0389

COG function: function code L; Nucleotidyltransferase/DNA polymerase involved in DNA repair

Gene ontology:

Cell location: Cytoplasm (Probable)

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 umuC domain

Homologues:

Organism=Homo sapiens, GI84043967, Length=293, Percent_Identity=26.962457337884, Blast_Score=116, Evalue=3e-26,
Organism=Homo sapiens, GI7706681, Length=294, Percent_Identity=26.8707482993197, Blast_Score=113, Evalue=3e-25,
Organism=Homo sapiens, GI7705344, Length=116, Percent_Identity=42.2413793103448, Blast_Score=92, Evalue=7e-19,
Organism=Homo sapiens, GI5729982, Length=122, Percent_Identity=34.4262295081967, Blast_Score=67, Evalue=3e-11,
Organism=Escherichia coli, GI1786425, Length=285, Percent_Identity=35.7894736842105, Blast_Score=169, Evalue=2e-43,
Organism=Escherichia coli, GI1787432, Length=220, Percent_Identity=30.9090909090909, Blast_Score=74, Evalue=1e-14,
Organism=Caenorhabditis elegans, GI17537959, Length=382, Percent_Identity=25.6544502617801, Blast_Score=103, Evalue=1e-22,
Organism=Caenorhabditis elegans, GI193205700, Length=423, Percent_Identity=27.1867612293144, Blast_Score=103, Evalue=2e-22,
Organism=Caenorhabditis elegans, GI115534089, Length=379, Percent_Identity=25.3298153034301, Blast_Score=87, Evalue=1e-17,
Organism=Saccharomyces cerevisiae, GI6324921, Length=255, Percent_Identity=25.0980392156863, Blast_Score=69, Evalue=1e-12,
Organism=Drosophila melanogaster, GI19923006, Length=297, Percent_Identity=27.6094276094276, Blast_Score=113, Evalue=2e-25,
Organism=Drosophila melanogaster, GI21355641, Length=286, Percent_Identity=30.0699300699301, Blast_Score=105, Evalue=4e-23,
Organism=Drosophila melanogaster, GI24644984, Length=286, Percent_Identity=30.0699300699301, Blast_Score=105, Evalue=4e-23,
Organism=Drosophila melanogaster, GI24668444, Length=184, Percent_Identity=26.0869565217391, Blast_Score=69, Evalue=4e-12,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): DPO41_METMA (Q8PYH6)

Other databases:

- EMBL:   AE008384
- RefSeq:   NP_632910.1
- ProteinModelPortal:   Q8PYH6
- SMR:   Q8PYH6
- GeneID:   1479228
- GenomeReviews:   AE008384_GR
- KEGG:   mma:MM_0886
- NMPDR:   fig|192952.1.peg.886
- HOGENOM:   HBG734504
- OMA:   PYATTEA
- ProtClustDB:   CLSK900520
- BioCyc:   MMAZ192952:MM0886-MONOMER
- BRENDA:   2.7.7.7
- GO:   GO:0005737
- HAMAP:   MF_01113
- InterPro:   IPR017962
- InterPro:   IPR017961
- InterPro:   IPR001126
- InterPro:   IPR017963
- InterPro:   IPR022880
- Gene3D:   G3DSA:3.30.1490.100
- PANTHER:   PTHR11076

Pfam domain/function: PF00817 IMS; SSF100879 DNA_pol_Y-fam_little_finger

EC number: =2.7.7.7

Molecular weight: Translated: 40707; Mature: 40707

Theoretical pI: Translated: 6.58; Mature: 6.58

Prosite motif: PS50173 UMUC

Important sites: ACT_SITE 114-114

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.1 %Cys     (Translated Protein)
2.7 %Met     (Translated Protein)
3.8 %Cys+Met (Translated Protein)
1.1 %Cys     (Mature Protein)
2.7 %Met     (Mature Protein)
3.8 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MMQRVVLHIDMDYFFAAIEERENPELREKAVVVCMLSGRSELSGSVSTCNYVAREFGIRS
CCCEEEEEECHHHHHHHHHCCCCCCHHHCEEEEEEECCCHHHCCCHHHHHHHHHHHCCCC
GMPCSRAKKLNPEAVFLPVRKDFYTSVSDRIMEILRSYADPGNGDSFEQISVDEAFLESS
CCCHHHHHCCCCCEEEEECHHHHHHHHHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHCC
ERTGGDFRLAFEVGMQIKKEIKEKENLTCSIGIGPNKLISKMASSAKKPDGITVVSPQDL
CCCCCCEEEHHHHHHHHHHHHHHHCCCEEEECCCHHHHHHHHHHHCCCCCCEEEECCCCC
EAFLWPLNVSKLWGIGSVTAGKLQEMGIVTVKDLAERDVIELISIFGKSRGTWLKQAASG
CHHEECCCHHHHCCCCCCCHHHHHHCCCCHHHHHHHHHHHHHHHHHCCCCCHHHHHHHCC
IDDSPLKERDGSEQIGRIATLPEDSLDKKLISSLIERLAGDVIEKLDSRELSFRIVTVTV
CCCCCCCCCCCHHHHCCEECCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEEEEEEEE
INSNFRMYTKSRTLSHPVSSKEVLLQVSGEILDEFLSENRTEFRRVGVRVGGLQKKKGQK
EECCEEEEECCCCCCCCCCCHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHCCCCCCCCCH
SLFDY
HCCCC
>Mature Secondary Structure
MMQRVVLHIDMDYFFAAIEERENPELREKAVVVCMLSGRSELSGSVSTCNYVAREFGIRS
CCCEEEEEECHHHHHHHHHCCCCCCHHHCEEEEEEECCCHHHCCCHHHHHHHHHHHCCCC
GMPCSRAKKLNPEAVFLPVRKDFYTSVSDRIMEILRSYADPGNGDSFEQISVDEAFLESS
CCCHHHHHCCCCCEEEEECHHHHHHHHHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHCC
ERTGGDFRLAFEVGMQIKKEIKEKENLTCSIGIGPNKLISKMASSAKKPDGITVVSPQDL
CCCCCCEEEHHHHHHHHHHHHHHHCCCEEEECCCHHHHHHHHHHHCCCCCCEEEECCCCC
EAFLWPLNVSKLWGIGSVTAGKLQEMGIVTVKDLAERDVIELISIFGKSRGTWLKQAASG
CHHEECCCHHHHCCCCCCCHHHHHHCCCCHHHHHHHHHHHHHHHHHCCCCCHHHHHHHCC
IDDSPLKERDGSEQIGRIATLPEDSLDKKLISSLIERLAGDVIEKLDSRELSFRIVTVTV
CCCCCCCCCCCHHHHCCEECCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEEEEEEEE
INSNFRMYTKSRTLSHPVSSKEVLLQVSGEILDEFLSENRTEFRRVGVRVGGLQKKKGQK
EECCEEEEECCCCCCCCCCCHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHCCCCCCCCCH
SLFDY
HCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 12125824