| Definition | Geobacillus thermodenitrificans NG80-2 chromosome, complete genome. |
|---|---|
| Accession | NC_009328 |
| Length | 3,550,319 |
Click here to switch to the map view.
The map label for this gene is dinB [H]
Identifier: 138895203
GI number: 138895203
Start: 1624756
End: 1625985
Strand: Direct
Name: dinB [H]
Synonym: GTNG_1543
Alternate gene names: 138895203
Gene position: 1624756-1625985 (Clockwise)
Preceding gene: 138895202
Following gene: 138895204
Centisome position: 45.76
GC content: 53.41
Gene sequence:
>1230_bases ATGCAAACGGAGCGCGAATCGCATGGGCGGATCATTTTTCATGTAGACGCCAATTCGTTTTTCGCTAGCTGTGAGATCGC CCGTGATCCATCGCTTCAGAAAAAACCGGTCGTTGTGGCAGGAGACCCGAAAGAGCGGAAAGGAATTGTGCTGGCGGCCA GCTATGTAGCGAAACAACAGTTTGGCATCTATACGACGATGCCGCTTTGGGAAGCGAAAAAACGCTGTCCATCGCTCGTC GTGCGGCCGCCGGATTTCGCGTTATACCGCGAAGTAAGCCGTCGCTTGTTTCAATGCTTACAGCGTTTCTCGCCCGTATT GGAGCGCGCCTCCATTGATGAAGGCTATTTGGACATGACCGGGCGGACGTCAACGGTTCACCCGCTCGCTTTGGCGCACC ATATCCAACAAGAACTGCTTGAGCGGTTGTCGATTCCGGTGAGTATTGGTATCGCCCCGAATAAGTTTTTGGCGAAAATG GCAAGCGACATGAAAAAGCCGCTTGGCATCACCGTGCTGCGCAAACGCGATGTCCCGCGCGTGTTATGGCCGCTTCCGGT CGAACACATGCATGGCGTTGGTGACAAAATGGCGAAAAAGCTGCATGCGCTTGACCTCCATACGATCGGTGATATTGCAA AGGCCGATCGGGAGCGTCTTCGTCAGACGTTTGGCATCTATGGTTTGCGCCTTCAAGAGAAAGCGAACGGCATCGATCCG CGTCCGGTTGATCCAGTGGCGGCGGAAAAGAGAAAATCGATCGGACACTCAACAACGTTGCCGTACGATATGGATGAGGA ACAGAACTTGCTCGTTGTCTTGCGCCAGTTGGCTGAGTCTGTCAGTGCGAGGATGAACGAAAAGCGGGTTGTCTCGCGGA CCGTTCAACTGACCATTCGCTACTACGATTTTCAAACCATCACTCGCAGCCAAACCGGAATGGATCCGTTATGGGATGCG GAAGACATCTTTTCCTATGCTGCACGGTTGTTCCAAAAGCATTGGGACGGTCGTCCAGTGCGGCTTCTTGGCGTTGCTGC GCTCCATGTGTTTGACCGGACCGGGGCGGTGAAGCAGCTTGATTTGTTTCACTATGAAGAGGATGCGAAAACAGAAACTC TTTGGAAAACGGTTGAACAGCTGCGGGCGAAATTCGGTGTTCGCGCCCTGCAAACGGGCGCCGAACTGCTTTCGACTGAC AGGAAAAAGAGGGAGGAGGAAGAACGTTGA
Upstream 100 bases:
>100_bases TGAATGTAACGAACCCGTATCCTGAAGCAAGCCGAGCGGTTTCCAACGAACGGATGATCTGCTAAAATAGGAAACAACGA AAGAAAAGAAGGGAAGAAAG
Downstream 100 bases:
>100_bases CGATATTCATAGTTGCTGCGTCTGTCGTGATGCTTGCAGGCCTAGTCGGTACGCTCGCGCTGTCTGGACGGGGAGACGAG CAGTACACATCAGCAACAAA
Product: DNA polymerase IV
Products: NA
Alternate protein names: Pol IV [H]
Number of amino acids: Translated: 409; Mature: 409
Protein sequence:
>409_residues MQTERESHGRIIFHVDANSFFASCEIARDPSLQKKPVVVAGDPKERKGIVLAASYVAKQQFGIYTTMPLWEAKKRCPSLV VRPPDFALYREVSRRLFQCLQRFSPVLERASIDEGYLDMTGRTSTVHPLALAHHIQQELLERLSIPVSIGIAPNKFLAKM ASDMKKPLGITVLRKRDVPRVLWPLPVEHMHGVGDKMAKKLHALDLHTIGDIAKADRERLRQTFGIYGLRLQEKANGIDP RPVDPVAAEKRKSIGHSTTLPYDMDEEQNLLVVLRQLAESVSARMNEKRVVSRTVQLTIRYYDFQTITRSQTGMDPLWDA EDIFSYAARLFQKHWDGRPVRLLGVAALHVFDRTGAVKQLDLFHYEEDAKTETLWKTVEQLRAKFGVRALQTGAELLSTD RKKREEEER
Sequences:
>Translated_409_residues MQTERESHGRIIFHVDANSFFASCEIARDPSLQKKPVVVAGDPKERKGIVLAASYVAKQQFGIYTTMPLWEAKKRCPSLV VRPPDFALYREVSRRLFQCLQRFSPVLERASIDEGYLDMTGRTSTVHPLALAHHIQQELLERLSIPVSIGIAPNKFLAKM ASDMKKPLGITVLRKRDVPRVLWPLPVEHMHGVGDKMAKKLHALDLHTIGDIAKADRERLRQTFGIYGLRLQEKANGIDP RPVDPVAAEKRKSIGHSTTLPYDMDEEQNLLVVLRQLAESVSARMNEKRVVSRTVQLTIRYYDFQTITRSQTGMDPLWDA EDIFSYAARLFQKHWDGRPVRLLGVAALHVFDRTGAVKQLDLFHYEEDAKTETLWKTVEQLRAKFGVRALQTGAELLSTD RKKREEEER >Mature_409_residues MQTERESHGRIIFHVDANSFFASCEIARDPSLQKKPVVVAGDPKERKGIVLAASYVAKQQFGIYTTMPLWEAKKRCPSLV VRPPDFALYREVSRRLFQCLQRFSPVLERASIDEGYLDMTGRTSTVHPLALAHHIQQELLERLSIPVSIGIAPNKFLAKM ASDMKKPLGITVLRKRDVPRVLWPLPVEHMHGVGDKMAKKLHALDLHTIGDIAKADRERLRQTFGIYGLRLQEKANGIDP RPVDPVAAEKRKSIGHSTTLPYDMDEEQNLLVVLRQLAESVSARMNEKRVVSRTVQLTIRYYDFQTITRSQTGMDPLWDA EDIFSYAARLFQKHWDGRPVRLLGVAALHVFDRTGAVKQLDLFHYEEDAKTETLWKTVEQLRAKFGVRALQTGAELLSTD RKKREEEER
Specific function: Poorly processive, error-prone DNA polymerase involved in untargeted mutagenesis. Copies undamaged DNA at stalled replication forks, which arise in vivo from mismatched or misaligned primer ends. These misaligned primers can be extended by polIV. Exhibits
COG id: COG0389
COG function: function code L; Nucleotidyltransferase/DNA polymerase involved in DNA repair
Gene ontology:
Cell location: Cytoplasm (Probable) [H]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 1 umuC domain [H]
Homologues:
Organism=Homo sapiens, GI154350220, Length=273, Percent_Identity=28.2051282051282, Blast_Score=106, Evalue=4e-23, Organism=Homo sapiens, GI84043967, Length=345, Percent_Identity=26.0869565217391, Blast_Score=104, Evalue=1e-22, Organism=Homo sapiens, GI7706681, Length=346, Percent_Identity=26.0115606936416, Blast_Score=104, Evalue=2e-22, Organism=Homo sapiens, GI7705344, Length=112, Percent_Identity=33.0357142857143, Blast_Score=79, Evalue=1e-14, Organism=Homo sapiens, GI5729982, Length=155, Percent_Identity=30.3225806451613, Blast_Score=71, Evalue=2e-12, Organism=Escherichia coli, GI1786425, Length=348, Percent_Identity=34.4827586206897, Blast_Score=185, Evalue=5e-48, Organism=Escherichia coli, GI1787432, Length=398, Percent_Identity=28.391959798995, Blast_Score=112, Evalue=4e-26, Organism=Caenorhabditis elegans, GI17537959, Length=354, Percent_Identity=25.4237288135593, Blast_Score=99, Evalue=4e-21, Organism=Caenorhabditis elegans, GI193205700, Length=272, Percent_Identity=29.0441176470588, Blast_Score=72, Evalue=4e-13, Organism=Caenorhabditis elegans, GI193205702, Length=267, Percent_Identity=29.9625468164794, Blast_Score=72, Evalue=6e-13, Organism=Caenorhabditis elegans, GI115534089, Length=127, Percent_Identity=32.2834645669291, Blast_Score=68, Evalue=7e-12, Organism=Drosophila melanogaster, GI19923006, Length=340, Percent_Identity=26.1764705882353, Blast_Score=114, Evalue=1e-25, Organism=Drosophila melanogaster, GI21355641, Length=342, Percent_Identity=28.3625730994152, Blast_Score=112, Evalue=5e-25, Organism=Drosophila melanogaster, GI24644984, Length=342, Percent_Identity=28.3625730994152, Blast_Score=112, Evalue=5e-25, Organism=Drosophila melanogaster, GI24668444, Length=167, Percent_Identity=31.1377245508982, Blast_Score=73, Evalue=4e-13,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR017962 - InterPro: IPR017961 - InterPro: IPR001126 - InterPro: IPR017963 - InterPro: IPR022880 [H]
Pfam domain/function: PF00817 IMS [H]
EC number: =2.7.7.7 [H]
Molecular weight: Translated: 46727; Mature: 46727
Theoretical pI: Translated: 9.92; Mature: 9.92
Prosite motif: PS50173 UMUC
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.7 %Cys (Translated Protein) 2.4 %Met (Translated Protein) 3.2 %Cys+Met (Translated Protein) 0.7 %Cys (Mature Protein) 2.4 %Met (Mature Protein) 3.2 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MQTERESHGRIIFHVDANSFFASCEIARDPSLQKKPVVVAGDPKERKGIVLAASYVAKQQ CCCCCCCCCEEEEEECCCCEEEEEEECCCCCCCCCCEEEECCCCCCCCEEEEHHHHHHHH FGIYTTMPLWEAKKRCPSLVVRPPDFALYREVSRRLFQCLQRFSPVLERASIDEGYLDMT CCCEECCCHHHHHHCCCCEEECCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCEECC GRTSTVHPLALAHHIQQELLERLSIPVSIGIAPNKFLAKMASDMKKPLGITVLRKRDVPR CCCCCCHHHHHHHHHHHHHHHHHCCCEEECCCCHHHHHHHHHHHCCCCCEEEEECCCCCC VLWPLPVEHMHGVGDKMAKKLHALDLHTIGDIAKADRERLRQTFGIYGLRLQEKANGIDP EECCCCHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCEEEHHHCCCCCC RPVDPVAAEKRKSIGHSTTLPYDMDEEQNLLVVLRQLAESVSARMNEKRVVSRTVQLTIR CCCCCHHHHHHHHCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHEEEEEE YYDFQTITRSQTGMDPLWDAEDIFSYAARLFQKHWDGRPVRLLGVAALHVFDRTGAVKQL EEEHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHCCCCHHHH DLFHYEEDAKTETLWKTVEQLRAKFGVRALQTGAELLSTDRKKREEEER HHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCC >Mature Secondary Structure MQTERESHGRIIFHVDANSFFASCEIARDPSLQKKPVVVAGDPKERKGIVLAASYVAKQQ CCCCCCCCCEEEEEECCCCEEEEEEECCCCCCCCCCEEEECCCCCCCCEEEEHHHHHHHH FGIYTTMPLWEAKKRCPSLVVRPPDFALYREVSRRLFQCLQRFSPVLERASIDEGYLDMT CCCEECCCHHHHHHCCCCEEECCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCEECC GRTSTVHPLALAHHIQQELLERLSIPVSIGIAPNKFLAKMASDMKKPLGITVLRKRDVPR CCCCCCHHHHHHHHHHHHHHHHHCCCEEECCCCHHHHHHHHHHHCCCCCEEEEECCCCCC VLWPLPVEHMHGVGDKMAKKLHALDLHTIGDIAKADRERLRQTFGIYGLRLQEKANGIDP EECCCCHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCEEEHHHCCCCCC RPVDPVAAEKRKSIGHSTTLPYDMDEEQNLLVVLRQLAESVSARMNEKRVVSRTVQLTIR CCCCCHHHHHHHHCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHEEEEEE YYDFQTITRSQTGMDPLWDAEDIFSYAARLFQKHWDGRPVRLLGVAALHVFDRTGAVKQL EEEHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHCCCCHHHH DLFHYEEDAKTETLWKTVEQLRAKFGVRALQTGAELLSTDRKKREEEER HHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 12721630 [H]