Definition Geobacillus thermodenitrificans NG80-2 chromosome, complete genome.
Accession NC_009328
Length 3,550,319

Click here to switch to the map view.

The map label for this gene is dinB [H]

Identifier: 138895203

GI number: 138895203

Start: 1624756

End: 1625985

Strand: Direct

Name: dinB [H]

Synonym: GTNG_1543

Alternate gene names: 138895203

Gene position: 1624756-1625985 (Clockwise)

Preceding gene: 138895202

Following gene: 138895204

Centisome position: 45.76

GC content: 53.41

Gene sequence:

>1230_bases
ATGCAAACGGAGCGCGAATCGCATGGGCGGATCATTTTTCATGTAGACGCCAATTCGTTTTTCGCTAGCTGTGAGATCGC
CCGTGATCCATCGCTTCAGAAAAAACCGGTCGTTGTGGCAGGAGACCCGAAAGAGCGGAAAGGAATTGTGCTGGCGGCCA
GCTATGTAGCGAAACAACAGTTTGGCATCTATACGACGATGCCGCTTTGGGAAGCGAAAAAACGCTGTCCATCGCTCGTC
GTGCGGCCGCCGGATTTCGCGTTATACCGCGAAGTAAGCCGTCGCTTGTTTCAATGCTTACAGCGTTTCTCGCCCGTATT
GGAGCGCGCCTCCATTGATGAAGGCTATTTGGACATGACCGGGCGGACGTCAACGGTTCACCCGCTCGCTTTGGCGCACC
ATATCCAACAAGAACTGCTTGAGCGGTTGTCGATTCCGGTGAGTATTGGTATCGCCCCGAATAAGTTTTTGGCGAAAATG
GCAAGCGACATGAAAAAGCCGCTTGGCATCACCGTGCTGCGCAAACGCGATGTCCCGCGCGTGTTATGGCCGCTTCCGGT
CGAACACATGCATGGCGTTGGTGACAAAATGGCGAAAAAGCTGCATGCGCTTGACCTCCATACGATCGGTGATATTGCAA
AGGCCGATCGGGAGCGTCTTCGTCAGACGTTTGGCATCTATGGTTTGCGCCTTCAAGAGAAAGCGAACGGCATCGATCCG
CGTCCGGTTGATCCAGTGGCGGCGGAAAAGAGAAAATCGATCGGACACTCAACAACGTTGCCGTACGATATGGATGAGGA
ACAGAACTTGCTCGTTGTCTTGCGCCAGTTGGCTGAGTCTGTCAGTGCGAGGATGAACGAAAAGCGGGTTGTCTCGCGGA
CCGTTCAACTGACCATTCGCTACTACGATTTTCAAACCATCACTCGCAGCCAAACCGGAATGGATCCGTTATGGGATGCG
GAAGACATCTTTTCCTATGCTGCACGGTTGTTCCAAAAGCATTGGGACGGTCGTCCAGTGCGGCTTCTTGGCGTTGCTGC
GCTCCATGTGTTTGACCGGACCGGGGCGGTGAAGCAGCTTGATTTGTTTCACTATGAAGAGGATGCGAAAACAGAAACTC
TTTGGAAAACGGTTGAACAGCTGCGGGCGAAATTCGGTGTTCGCGCCCTGCAAACGGGCGCCGAACTGCTTTCGACTGAC
AGGAAAAAGAGGGAGGAGGAAGAACGTTGA

Upstream 100 bases:

>100_bases
TGAATGTAACGAACCCGTATCCTGAAGCAAGCCGAGCGGTTTCCAACGAACGGATGATCTGCTAAAATAGGAAACAACGA
AAGAAAAGAAGGGAAGAAAG

Downstream 100 bases:

>100_bases
CGATATTCATAGTTGCTGCGTCTGTCGTGATGCTTGCAGGCCTAGTCGGTACGCTCGCGCTGTCTGGACGGGGAGACGAG
CAGTACACATCAGCAACAAA

Product: DNA polymerase IV

Products: NA

Alternate protein names: Pol IV [H]

Number of amino acids: Translated: 409; Mature: 409

Protein sequence:

>409_residues
MQTERESHGRIIFHVDANSFFASCEIARDPSLQKKPVVVAGDPKERKGIVLAASYVAKQQFGIYTTMPLWEAKKRCPSLV
VRPPDFALYREVSRRLFQCLQRFSPVLERASIDEGYLDMTGRTSTVHPLALAHHIQQELLERLSIPVSIGIAPNKFLAKM
ASDMKKPLGITVLRKRDVPRVLWPLPVEHMHGVGDKMAKKLHALDLHTIGDIAKADRERLRQTFGIYGLRLQEKANGIDP
RPVDPVAAEKRKSIGHSTTLPYDMDEEQNLLVVLRQLAESVSARMNEKRVVSRTVQLTIRYYDFQTITRSQTGMDPLWDA
EDIFSYAARLFQKHWDGRPVRLLGVAALHVFDRTGAVKQLDLFHYEEDAKTETLWKTVEQLRAKFGVRALQTGAELLSTD
RKKREEEER

Sequences:

>Translated_409_residues
MQTERESHGRIIFHVDANSFFASCEIARDPSLQKKPVVVAGDPKERKGIVLAASYVAKQQFGIYTTMPLWEAKKRCPSLV
VRPPDFALYREVSRRLFQCLQRFSPVLERASIDEGYLDMTGRTSTVHPLALAHHIQQELLERLSIPVSIGIAPNKFLAKM
ASDMKKPLGITVLRKRDVPRVLWPLPVEHMHGVGDKMAKKLHALDLHTIGDIAKADRERLRQTFGIYGLRLQEKANGIDP
RPVDPVAAEKRKSIGHSTTLPYDMDEEQNLLVVLRQLAESVSARMNEKRVVSRTVQLTIRYYDFQTITRSQTGMDPLWDA
EDIFSYAARLFQKHWDGRPVRLLGVAALHVFDRTGAVKQLDLFHYEEDAKTETLWKTVEQLRAKFGVRALQTGAELLSTD
RKKREEEER
>Mature_409_residues
MQTERESHGRIIFHVDANSFFASCEIARDPSLQKKPVVVAGDPKERKGIVLAASYVAKQQFGIYTTMPLWEAKKRCPSLV
VRPPDFALYREVSRRLFQCLQRFSPVLERASIDEGYLDMTGRTSTVHPLALAHHIQQELLERLSIPVSIGIAPNKFLAKM
ASDMKKPLGITVLRKRDVPRVLWPLPVEHMHGVGDKMAKKLHALDLHTIGDIAKADRERLRQTFGIYGLRLQEKANGIDP
RPVDPVAAEKRKSIGHSTTLPYDMDEEQNLLVVLRQLAESVSARMNEKRVVSRTVQLTIRYYDFQTITRSQTGMDPLWDA
EDIFSYAARLFQKHWDGRPVRLLGVAALHVFDRTGAVKQLDLFHYEEDAKTETLWKTVEQLRAKFGVRALQTGAELLSTD
RKKREEEER

Specific function: Poorly processive, error-prone DNA polymerase involved in untargeted mutagenesis. Copies undamaged DNA at stalled replication forks, which arise in vivo from mismatched or misaligned primer ends. These misaligned primers can be extended by polIV. Exhibits

COG id: COG0389

COG function: function code L; Nucleotidyltransferase/DNA polymerase involved in DNA repair

Gene ontology:

Cell location: Cytoplasm (Probable) [H]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 umuC domain [H]

Homologues:

Organism=Homo sapiens, GI154350220, Length=273, Percent_Identity=28.2051282051282, Blast_Score=106, Evalue=4e-23,
Organism=Homo sapiens, GI84043967, Length=345, Percent_Identity=26.0869565217391, Blast_Score=104, Evalue=1e-22,
Organism=Homo sapiens, GI7706681, Length=346, Percent_Identity=26.0115606936416, Blast_Score=104, Evalue=2e-22,
Organism=Homo sapiens, GI7705344, Length=112, Percent_Identity=33.0357142857143, Blast_Score=79, Evalue=1e-14,
Organism=Homo sapiens, GI5729982, Length=155, Percent_Identity=30.3225806451613, Blast_Score=71, Evalue=2e-12,
Organism=Escherichia coli, GI1786425, Length=348, Percent_Identity=34.4827586206897, Blast_Score=185, Evalue=5e-48,
Organism=Escherichia coli, GI1787432, Length=398, Percent_Identity=28.391959798995, Blast_Score=112, Evalue=4e-26,
Organism=Caenorhabditis elegans, GI17537959, Length=354, Percent_Identity=25.4237288135593, Blast_Score=99, Evalue=4e-21,
Organism=Caenorhabditis elegans, GI193205700, Length=272, Percent_Identity=29.0441176470588, Blast_Score=72, Evalue=4e-13,
Organism=Caenorhabditis elegans, GI193205702, Length=267, Percent_Identity=29.9625468164794, Blast_Score=72, Evalue=6e-13,
Organism=Caenorhabditis elegans, GI115534089, Length=127, Percent_Identity=32.2834645669291, Blast_Score=68, Evalue=7e-12,
Organism=Drosophila melanogaster, GI19923006, Length=340, Percent_Identity=26.1764705882353, Blast_Score=114, Evalue=1e-25,
Organism=Drosophila melanogaster, GI21355641, Length=342, Percent_Identity=28.3625730994152, Blast_Score=112, Evalue=5e-25,
Organism=Drosophila melanogaster, GI24644984, Length=342, Percent_Identity=28.3625730994152, Blast_Score=112, Evalue=5e-25,
Organism=Drosophila melanogaster, GI24668444, Length=167, Percent_Identity=31.1377245508982, Blast_Score=73, Evalue=4e-13,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR017962
- InterPro:   IPR017961
- InterPro:   IPR001126
- InterPro:   IPR017963
- InterPro:   IPR022880 [H]

Pfam domain/function: PF00817 IMS [H]

EC number: =2.7.7.7 [H]

Molecular weight: Translated: 46727; Mature: 46727

Theoretical pI: Translated: 9.92; Mature: 9.92

Prosite motif: PS50173 UMUC

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.7 %Cys     (Translated Protein)
2.4 %Met     (Translated Protein)
3.2 %Cys+Met (Translated Protein)
0.7 %Cys     (Mature Protein)
2.4 %Met     (Mature Protein)
3.2 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MQTERESHGRIIFHVDANSFFASCEIARDPSLQKKPVVVAGDPKERKGIVLAASYVAKQQ
CCCCCCCCCEEEEEECCCCEEEEEEECCCCCCCCCCEEEECCCCCCCCEEEEHHHHHHHH
FGIYTTMPLWEAKKRCPSLVVRPPDFALYREVSRRLFQCLQRFSPVLERASIDEGYLDMT
CCCEECCCHHHHHHCCCCEEECCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCEECC
GRTSTVHPLALAHHIQQELLERLSIPVSIGIAPNKFLAKMASDMKKPLGITVLRKRDVPR
CCCCCCHHHHHHHHHHHHHHHHHCCCEEECCCCHHHHHHHHHHHCCCCCEEEEECCCCCC
VLWPLPVEHMHGVGDKMAKKLHALDLHTIGDIAKADRERLRQTFGIYGLRLQEKANGIDP
EECCCCHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCEEEHHHCCCCCC
RPVDPVAAEKRKSIGHSTTLPYDMDEEQNLLVVLRQLAESVSARMNEKRVVSRTVQLTIR
CCCCCHHHHHHHHCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHEEEEEE
YYDFQTITRSQTGMDPLWDAEDIFSYAARLFQKHWDGRPVRLLGVAALHVFDRTGAVKQL
EEEHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHCCCCHHHH
DLFHYEEDAKTETLWKTVEQLRAKFGVRALQTGAELLSTDRKKREEEER
HHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCC
>Mature Secondary Structure
MQTERESHGRIIFHVDANSFFASCEIARDPSLQKKPVVVAGDPKERKGIVLAASYVAKQQ
CCCCCCCCCEEEEEECCCCEEEEEEECCCCCCCCCCEEEECCCCCCCCEEEEHHHHHHHH
FGIYTTMPLWEAKKRCPSLVVRPPDFALYREVSRRLFQCLQRFSPVLERASIDEGYLDMT
CCCEECCCHHHHHHCCCCEEECCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCEECC
GRTSTVHPLALAHHIQQELLERLSIPVSIGIAPNKFLAKMASDMKKPLGITVLRKRDVPR
CCCCCCHHHHHHHHHHHHHHHHHCCCEEECCCCHHHHHHHHHHHCCCCCEEEEECCCCCC
VLWPLPVEHMHGVGDKMAKKLHALDLHTIGDIAKADRERLRQTFGIYGLRLQEKANGIDP
EECCCCHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCEEEHHHCCCCCC
RPVDPVAAEKRKSIGHSTTLPYDMDEEQNLLVVLRQLAESVSARMNEKRVVSRTVQLTIR
CCCCCHHHHHHHHCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHEEEEEE
YYDFQTITRSQTGMDPLWDAEDIFSYAARLFQKHWDGRPVRLLGVAALHVFDRTGAVKQL
EEEHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHCCCCHHHH
DLFHYEEDAKTETLWKTVEQLRAKFGVRALQTGAELLSTDRKKREEEER
HHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 12721630 [H]