Definition Methylobacterium chloromethanicum CM4, complete genome.
Accession NC_011757
Length 5,777,908

Click here to switch to the map view.

The map label for this gene is dinB [H]

Identifier: 218533062

GI number: 218533062

Start: 5551903

End: 5553180

Strand: Reverse

Name: dinB [H]

Synonym: Mchl_5188

Alternate gene names: 218533062

Gene position: 5553180-5551903 (Counterclockwise)

Preceding gene: 218533065

Following gene: 218533060

Centisome position: 96.11

GC content: 70.81

Gene sequence:

>1278_bases
GTGAGACCCTTCTGCCGCGATTGCCTGACGATGCAAGCCGAGGGCGCCCTGCGCTGCCGCGGATGCGGCTCGCCGCGCCT
GCTCTCGCACCCGGCCCGCGACGCCTTGAGCATCGCCCACGTCGATTGCGACGCCTTCTACGCGGCGATCGAGAAGCGCG
ACGACCCGTCCCTGCGCGACAAGCCGCTCATCATCGGCGGGGGCAAGCGCGGCGTCGTCTCCACCGCCTGCTATCTCGCC
CGGATCTCCGGCGTGCGCTCGGCGATGCCGATGTTCGAGGCGTTGAAGCGCTGCCCCGATGCCACCGTGCTGCGGCCGGA
TATGGAAAAATACGCCCGCGTCGGGCGCGAGGTACGGGCGATGATGCTGGCGCTCACGCCGCTGGTCGAGCCGGTCTCCA
TCGACGAGGCGTTTCTCGACCTCTCCGGCACCGAGCGCCTGCACGGGACGAGCCCGGCGCTCACGCTTGTCCGCTTCGCC
GCACGGGTCGAGGCGGAGGTCGGCATCTCCGTGTCGGTGGGACTGTCCGACAACAAGTTCCTGGCCAAGATCGCCTCCGA
TCTCGACAAGCCACGCGGCTTCTCGATCATCGCGGGCGAGGACGCCGCGACCTTCCTCGCCGACAAGCCGGTCGGCATCC
TGCCCGGTATCGGCGAAAGTGCGCGAAACCGCCTCGCGTCCCTCAACATCCACCGCGTCGGCGACATCCCGCGGGCCGAT
CCGACGCGCCTCCAGGCATCCCTCGGGCGCGATGCGCTGCGTCTCATCGATCTCGCCGCCGGCCGGGACCGGCGGCCGGT
GCGCCCGACCCGGGAGGCCAAGAGCGTCTCGTCCGAGACGACCTTCTCGACCGATCTCACCCGGTTCGAGGATCTGCGGC
CGATCCTCTGGCAGCTCTGCGAAAAGGTGTCGGCACGGCTCAAGCGGGCAGAACTCGCCGCCGGCAGCGTCACGCTGAAG
CTGAAGGATGCCCGATTCCAGCTGCGGACCCGCACCCGCGGCGGCCTGAAACCCACCCAGCTCGCCGACCGCCTGTTCCG
CGAGGGCGAGCCCATGCTGCGGGCGGCCTGCGACGGCACGGCCTTCCGGCTGATCGGCATCGGCGGCGGCGATCTCTGCG
GCGCGATCCATGCCGACCGCGGCGATCTCGCCGATCAGGGTATCGAGCGCGTCGCCCGCCGCGAGGCGGCGCTCGACCGG
CTGCGGGAAAAGTTCGGCAGCGCCGCGATTCAGCGCGGGCTCGTCTTCACCGGCGAGCCGGAGCGGCGGCGCACCTGA

Upstream 100 bases:

>100_bases
GTGGGATGGCGCGCGGGAGAACCCTGGTCGGCGGCTCCGGACATTCGTACAACCTGTCTCGCCCGCATCAGCCCGGCAAA
GGTCGGGCGAGGTTTTCGAC

Downstream 100 bases:

>100_bases
GGCGCGGCGACTACTTCTTGCAGGTGGGATCGGCCTTCGGGTCGGCTTTGGCGAGGTCGAGCCGCGTCAGATTTCCGTCG
ATGGCGAAATCCCCGTAATC

Product: DNA polymerase IV

Products: NA

Alternate protein names: Pol IV [H]

Number of amino acids: Translated: 425; Mature: 425

Protein sequence:

>425_residues
MRPFCRDCLTMQAEGALRCRGCGSPRLLSHPARDALSIAHVDCDAFYAAIEKRDDPSLRDKPLIIGGGKRGVVSTACYLA
RISGVRSAMPMFEALKRCPDATVLRPDMEKYARVGREVRAMMLALTPLVEPVSIDEAFLDLSGTERLHGTSPALTLVRFA
ARVEAEVGISVSVGLSDNKFLAKIASDLDKPRGFSIIAGEDAATFLADKPVGILPGIGESARNRLASLNIHRVGDIPRAD
PTRLQASLGRDALRLIDLAAGRDRRPVRPTREAKSVSSETTFSTDLTRFEDLRPILWQLCEKVSARLKRAELAAGSVTLK
LKDARFQLRTRTRGGLKPTQLADRLFREGEPMLRAACDGTAFRLIGIGGGDLCGAIHADRGDLADQGIERVARREAALDR
LREKFGSAAIQRGLVFTGEPERRRT

Sequences:

>Translated_425_residues
MRPFCRDCLTMQAEGALRCRGCGSPRLLSHPARDALSIAHVDCDAFYAAIEKRDDPSLRDKPLIIGGGKRGVVSTACYLA
RISGVRSAMPMFEALKRCPDATVLRPDMEKYARVGREVRAMMLALTPLVEPVSIDEAFLDLSGTERLHGTSPALTLVRFA
ARVEAEVGISVSVGLSDNKFLAKIASDLDKPRGFSIIAGEDAATFLADKPVGILPGIGESARNRLASLNIHRVGDIPRAD
PTRLQASLGRDALRLIDLAAGRDRRPVRPTREAKSVSSETTFSTDLTRFEDLRPILWQLCEKVSARLKRAELAAGSVTLK
LKDARFQLRTRTRGGLKPTQLADRLFREGEPMLRAACDGTAFRLIGIGGGDLCGAIHADRGDLADQGIERVARREAALDR
LREKFGSAAIQRGLVFTGEPERRRT
>Mature_425_residues
MRPFCRDCLTMQAEGALRCRGCGSPRLLSHPARDALSIAHVDCDAFYAAIEKRDDPSLRDKPLIIGGGKRGVVSTACYLA
RISGVRSAMPMFEALKRCPDATVLRPDMEKYARVGREVRAMMLALTPLVEPVSIDEAFLDLSGTERLHGTSPALTLVRFA
ARVEAEVGISVSVGLSDNKFLAKIASDLDKPRGFSIIAGEDAATFLADKPVGILPGIGESARNRLASLNIHRVGDIPRAD
PTRLQASLGRDALRLIDLAAGRDRRPVRPTREAKSVSSETTFSTDLTRFEDLRPILWQLCEKVSARLKRAELAAGSVTLK
LKDARFQLRTRTRGGLKPTQLADRLFREGEPMLRAACDGTAFRLIGIGGGDLCGAIHADRGDLADQGIERVARREAALDR
LREKFGSAAIQRGLVFTGEPERRRT

Specific function: Poorly processive, error-prone DNA polymerase involved in untargeted mutagenesis. Copies undamaged DNA at stalled replication forks, which arise in vivo from mismatched or misaligned primer ends. These misaligned primers can be extended by polIV. Exhibits

COG id: COG0389

COG function: function code L; Nucleotidyltransferase/DNA polymerase involved in DNA repair

Gene ontology:

Cell location: Cytoplasm (Probable) [H]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 umuC domain [H]

Homologues:

Organism=Homo sapiens, GI84043967, Length=364, Percent_Identity=27.1978021978022, Blast_Score=111, Evalue=1e-24,
Organism=Homo sapiens, GI7706681, Length=365, Percent_Identity=27.1232876712329, Blast_Score=110, Evalue=2e-24,
Organism=Homo sapiens, GI7705344, Length=415, Percent_Identity=25.5421686746988, Blast_Score=109, Evalue=5e-24,
Organism=Homo sapiens, GI154350220, Length=293, Percent_Identity=28.3276450511945, Blast_Score=101, Evalue=1e-21,
Organism=Escherichia coli, GI1786425, Length=300, Percent_Identity=36.3333333333333, Blast_Score=177, Evalue=9e-46,
Organism=Escherichia coli, GI1787432, Length=212, Percent_Identity=28.7735849056604, Blast_Score=69, Evalue=4e-13,
Organism=Caenorhabditis elegans, GI193205700, Length=396, Percent_Identity=29.5454545454545, Blast_Score=127, Evalue=1e-29,
Organism=Caenorhabditis elegans, GI17537959, Length=314, Percent_Identity=27.0700636942675, Blast_Score=103, Evalue=2e-22,
Organism=Caenorhabditis elegans, GI193205702, Length=348, Percent_Identity=27.2988505747126, Blast_Score=84, Evalue=1e-16,
Organism=Saccharomyces cerevisiae, GI6324921, Length=319, Percent_Identity=25.3918495297806, Blast_Score=80, Evalue=7e-16,
Organism=Drosophila melanogaster, GI19923006, Length=251, Percent_Identity=27.8884462151394, Blast_Score=104, Evalue=1e-22,
Organism=Drosophila melanogaster, GI21355641, Length=312, Percent_Identity=28.2051282051282, Blast_Score=104, Evalue=1e-22,
Organism=Drosophila melanogaster, GI24644984, Length=312, Percent_Identity=28.2051282051282, Blast_Score=104, Evalue=1e-22,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR017962
- InterPro:   IPR017961
- InterPro:   IPR001126
- InterPro:   IPR017963
- InterPro:   IPR022880 [H]

Pfam domain/function: PF00817 IMS [H]

EC number: =2.7.7.7 [H]

Molecular weight: Translated: 46348; Mature: 46348

Theoretical pI: Translated: 10.09; Mature: 10.09

Prosite motif: PS50173 UMUC

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

2.4 %Cys     (Translated Protein)
1.9 %Met     (Translated Protein)
4.2 %Cys+Met (Translated Protein)
2.4 %Cys     (Mature Protein)
1.9 %Met     (Mature Protein)
4.2 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MRPFCRDCLTMQAEGALRCRGCGSPRLLSHPARDALSIAHVDCDAFYAAIEKRDDPSLRD
CCCHHHHHHHHCCCCCEEECCCCCCCCCCCCCHHHHEEEEECHHHHHHHHHCCCCCCCCC
KPLIIGGGKRGVVSTACYLARISGVRSAMPMFEALKRCPDATVLRPDMEKYARVGREVRA
CCEEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCEECCCHHHHHHHHHHHHH
MMLALTPLVEPVSIDEAFLDLSGTERLHGTSPALTLVRFAARVEAEVGISVSVGLSDNKF
HHHHHHHCCCCCCHHHHHHCCCCCCCCCCCCHHHHHHHHHHHHHHHCCEEEEECCCCCHH
LAKIASDLDKPRGFSIIAGEDAATFLADKPVGILPGIGESARNRLASLNIHRVGDIPRAD
HHHHHHHCCCCCCCEEEECCCHHHHHCCCCCCCCCCCCHHHHHHHHHCCCCCCCCCCCCC
PTRLQASLGRDALRLIDLAAGRDRRPVRPTREAKSVSSETTFSTDLTRFEDLRPILWQLC
HHHHHHHHCHHHHHHHHHHCCCCCCCCCCCHHHHHCCCCCCCHHHHHHHHHHHHHHHHHH
EKVSARLKRAELAAGSVTLKLKDARFQLRTRTRGGLKPTQLADRLFREGEPMLRAACDGT
HHHHHHHHHHHHCCCEEEEEEECCCEEEHHHCCCCCCHHHHHHHHHHCCCHHHHHHCCCC
AFRLIGIGGGDLCGAIHADRGDLADQGIERVARREAALDRLREKFGSAAIQRGLVFTGEP
EEEEEECCCCHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCEECCCC
ERRRT
HHCCC
>Mature Secondary Structure
MRPFCRDCLTMQAEGALRCRGCGSPRLLSHPARDALSIAHVDCDAFYAAIEKRDDPSLRD
CCCHHHHHHHHCCCCCEEECCCCCCCCCCCCCHHHHEEEEECHHHHHHHHHCCCCCCCCC
KPLIIGGGKRGVVSTACYLARISGVRSAMPMFEALKRCPDATVLRPDMEKYARVGREVRA
CCEEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCEECCCHHHHHHHHHHHHH
MMLALTPLVEPVSIDEAFLDLSGTERLHGTSPALTLVRFAARVEAEVGISVSVGLSDNKF
HHHHHHHCCCCCCHHHHHHCCCCCCCCCCCCHHHHHHHHHHHHHHHCCEEEEECCCCCHH
LAKIASDLDKPRGFSIIAGEDAATFLADKPVGILPGIGESARNRLASLNIHRVGDIPRAD
HHHHHHHCCCCCCCEEEECCCHHHHHCCCCCCCCCCCCHHHHHHHHHCCCCCCCCCCCCC
PTRLQASLGRDALRLIDLAAGRDRRPVRPTREAKSVSSETTFSTDLTRFEDLRPILWQLC
HHHHHHHHCHHHHHHHHHHCCCCCCCCCCCHHHHHCCCCCCCHHHHHHHHHHHHHHHHHH
EKVSARLKRAELAAGSVTLKLKDARFQLRTRTRGGLKPTQLADRLFREGEPMLRAACDGT
HHHHHHHHHHHHCCCEEEEEEECCCEEEHHHCCCCCCHHHHHHHHHHCCCHHHHHHCCCC
AFRLIGIGGGDLCGAIHADRGDLADQGIERVARREAALDRLREKFGSAAIQRGLVFTGEP
EEEEEECCCCHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCEECCCC
ERRRT
HHCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 11756688 [H]