Definition Geobacter sulfurreducens PCA chromosome, complete genome.
Accession NC_002939
Length 3,814,139

Click here to switch to the map view.

The map label for this gene is dinB [H]

Identifier: 39996716

GI number: 39996716

Start: 1769602

End: 1770831

Strand: Reverse

Name: dinB [H]

Synonym: GSU1616

Alternate gene names: 39996716

Gene position: 1770831-1769602 (Counterclockwise)

Preceding gene: 39996717

Following gene: 39996715

Centisome position: 46.43

GC content: 54.55

Gene sequence:

>1230_bases
ATGAGCAATCATCGAACCATTCTCCATCTGGACATGAACGCCTTTTTTGCCTCGGTTGAGCAACAAGCAGACCCATCCCT
CCAAGGAAAGCCAGTTGCGGTCATCGGGTCAGGCGCGCGCACCATCATCACTACCGCATCCTACGAGGCACGCGCCCACG
GGGTCGGCACGGGCATGACAACCCACGAAGCAAAACGGCTCTGCCCGGAATTGATCCTCGTTATCGGCAACAACCGGGAA
TACACCCGTATTTCAAAACTGATCTTCGAAATGCTCGGGCAATTCACCCCCCTTGTGGAAGTCTTTTCCATTGACGAAGC
CTTTCTCGACTTGACCGGTTCGCTTCGACTTTTCGGCCGCGCCGACGTGATTGCCCGCGAGATCAAAGCCCGCATAAGGG
ACCGATTCGGCCTCACCTGCTCCATCGGCATCGCTCCCAACAAGCTTTTGGCAAAGCTGGCCTCGGACATGCAAAAGCCC
GATGGTCTCACCATCATCCCCCCCGAAAACGTGGCTTCACTCATGAAAACGACCCCGATCCGCAGCCTCTGCGGAATAGG
CCCATCCACTGAACAACGACTGAAATACCTCGGCATTTCAACCTGTAACGATCTGGGACACTTCAGCTCCAAGATACTTA
CCCGACATTTCGGTGCCATGGGAGCACGACTCAAACAGATGGGACAGGGCATTGACGACTCTCCCGTAATACCGACCACA
ACGGAAGAAGAAGTTAAAAGCGTCAGCCACAGTACAACCCTGGACCACGACCTCACCAACAAGGACGACATACATAAGTA
CCTGCTTATGTTATCGGAGATGGTAGGACGCCGCGCGCGCCGCTACAAAACCAAAGGGAAAACAGTTACCCTAACAATAC
GGTATGCCGATTTCACCACGTTCAGCCGCCAGGAAACCCTCCCCTCCCCATTGAATCGAAGCGGCGACATTTATCGAGCC
GTCACTGCACTGCTCGACACACTCCAATTAACGCAACCAATACGACTCCTGGGCGTTGCCATCAGCAACCTTGTACATGC
CTCGGAACAGCTCCCCCTCTTCCCGGAAGAACGGCGGCTCACAACCCTCTCGCAAGCCATGGATCAAGTCAATGACCGGT
TCGGAGAAACCACCATCACCTTTGGCACCTTGCTGGGACAAGACAACTGCTCGCACGTTATCGCCCCTGCCTGGAGACCC
GCTGGCATACGTGACGTAAAAGTAAAATAA

Upstream 100 bases:

>100_bases
GAGGCATGGATAATCGGCAAAGTTGTGGGTATTTACCGGCGTATGGATTAACACACAAACTCCTCAGTACACAGGTAAGT
AAATATACTGGCACTCAAGC

Downstream 100 bases:

>100_bases
TTAAAATATTCAAGCAAGATAGACAACAATATCTCACCTATTAGCACAACACATATCAAACTTACACACATACTCGATTA
CCCAGAAGCACCGGTCTCAG

Product: ImpB/MucB/SamB family protein

Products: NA

Alternate protein names: Pol IV [H]

Number of amino acids: Translated: 409; Mature: 408

Protein sequence:

>409_residues
MSNHRTILHLDMNAFFASVEQQADPSLQGKPVAVIGSGARTIITTASYEARAHGVGTGMTTHEAKRLCPELILVIGNNRE
YTRISKLIFEMLGQFTPLVEVFSIDEAFLDLTGSLRLFGRADVIAREIKARIRDRFGLTCSIGIAPNKLLAKLASDMQKP
DGLTIIPPENVASLMKTTPIRSLCGIGPSTEQRLKYLGISTCNDLGHFSSKILTRHFGAMGARLKQMGQGIDDSPVIPTT
TEEEVKSVSHSTTLDHDLTNKDDIHKYLLMLSEMVGRRARRYKTKGKTVTLTIRYADFTTFSRQETLPSPLNRSGDIYRA
VTALLDTLQLTQPIRLLGVAISNLVHASEQLPLFPEERRLTTLSQAMDQVNDRFGETTITFGTLLGQDNCSHVIAPAWRP
AGIRDVKVK

Sequences:

>Translated_409_residues
MSNHRTILHLDMNAFFASVEQQADPSLQGKPVAVIGSGARTIITTASYEARAHGVGTGMTTHEAKRLCPELILVIGNNRE
YTRISKLIFEMLGQFTPLVEVFSIDEAFLDLTGSLRLFGRADVIAREIKARIRDRFGLTCSIGIAPNKLLAKLASDMQKP
DGLTIIPPENVASLMKTTPIRSLCGIGPSTEQRLKYLGISTCNDLGHFSSKILTRHFGAMGARLKQMGQGIDDSPVIPTT
TEEEVKSVSHSTTLDHDLTNKDDIHKYLLMLSEMVGRRARRYKTKGKTVTLTIRYADFTTFSRQETLPSPLNRSGDIYRA
VTALLDTLQLTQPIRLLGVAISNLVHASEQLPLFPEERRLTTLSQAMDQVNDRFGETTITFGTLLGQDNCSHVIAPAWRP
AGIRDVKVK
>Mature_408_residues
SNHRTILHLDMNAFFASVEQQADPSLQGKPVAVIGSGARTIITTASYEARAHGVGTGMTTHEAKRLCPELILVIGNNREY
TRISKLIFEMLGQFTPLVEVFSIDEAFLDLTGSLRLFGRADVIAREIKARIRDRFGLTCSIGIAPNKLLAKLASDMQKPD
GLTIIPPENVASLMKTTPIRSLCGIGPSTEQRLKYLGISTCNDLGHFSSKILTRHFGAMGARLKQMGQGIDDSPVIPTTT
EEEVKSVSHSTTLDHDLTNKDDIHKYLLMLSEMVGRRARRYKTKGKTVTLTIRYADFTTFSRQETLPSPLNRSGDIYRAV
TALLDTLQLTQPIRLLGVAISNLVHASEQLPLFPEERRLTTLSQAMDQVNDRFGETTITFGTLLGQDNCSHVIAPAWRPA
GIRDVKVK

Specific function: Poorly processive, error-prone DNA polymerase involved in untargeted mutagenesis. Copies undamaged DNA at stalled replication forks, which arise in vivo from mismatched or misaligned primer ends. These misaligned primers can be extended by polIV. Exhibits

COG id: COG0389

COG function: function code L; Nucleotidyltransferase/DNA polymerase involved in DNA repair

Gene ontology:

Cell location: Cytoplasm [H]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 umuC domain [H]

Homologues:

Organism=Homo sapiens, GI84043967, Length=400, Percent_Identity=31.25, Blast_Score=157, Evalue=1e-38,
Organism=Homo sapiens, GI7706681, Length=401, Percent_Identity=31.1720698254364, Blast_Score=157, Evalue=2e-38,
Organism=Homo sapiens, GI154350220, Length=368, Percent_Identity=30.7065217391304, Blast_Score=147, Evalue=2e-35,
Organism=Homo sapiens, GI7705344, Length=110, Percent_Identity=42.7272727272727, Blast_Score=98, Evalue=2e-20,
Organism=Homo sapiens, GI5729982, Length=125, Percent_Identity=37.6, Blast_Score=81, Evalue=2e-15,
Organism=Escherichia coli, GI1786425, Length=343, Percent_Identity=33.5276967930029, Blast_Score=188, Evalue=6e-49,
Organism=Escherichia coli, GI1787432, Length=397, Percent_Identity=27.9596977329975, Blast_Score=109, Evalue=3e-25,
Organism=Caenorhabditis elegans, GI17537959, Length=245, Percent_Identity=27.7551020408163, Blast_Score=107, Evalue=1e-23,
Organism=Caenorhabditis elegans, GI193205700, Length=138, Percent_Identity=36.231884057971, Blast_Score=87, Evalue=2e-17,
Organism=Caenorhabditis elegans, GI193205702, Length=280, Percent_Identity=29.2857142857143, Blast_Score=82, Evalue=5e-16,
Organism=Caenorhabditis elegans, GI115534089, Length=123, Percent_Identity=39.0243902439024, Blast_Score=79, Evalue=5e-15,
Organism=Drosophila melanogaster, GI21355641, Length=276, Percent_Identity=32.6086956521739, Blast_Score=135, Evalue=4e-32,
Organism=Drosophila melanogaster, GI24644984, Length=276, Percent_Identity=32.6086956521739, Blast_Score=135, Evalue=4e-32,
Organism=Drosophila melanogaster, GI19923006, Length=341, Percent_Identity=27.2727272727273, Blast_Score=129, Evalue=3e-30,
Organism=Drosophila melanogaster, GI24668444, Length=124, Percent_Identity=37.9032258064516, Blast_Score=78, Evalue=1e-14,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR017962
- InterPro:   IPR017961
- InterPro:   IPR001126
- InterPro:   IPR017963
- InterPro:   IPR022880 [H]

Pfam domain/function: PF00817 IMS [H]

EC number: =2.7.7.7 [H]

Molecular weight: Translated: 45173; Mature: 45042

Theoretical pI: Translated: 9.36; Mature: 9.36

Prosite motif: PS50173 UMUC ; PS00216 SUGAR_TRANSPORT_1

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.2 %Cys     (Translated Protein)
2.7 %Met     (Translated Protein)
3.9 %Cys+Met (Translated Protein)
1.2 %Cys     (Mature Protein)
2.5 %Met     (Mature Protein)
3.7 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSNHRTILHLDMNAFFASVEQQADPSLQGKPVAVIGSGARTIITTASYEARAHGVGTGMT
CCCCCEEEEEEHHHHHHHHHHHCCCCCCCCCEEEEECCCEEEEEECCCCHHHCCCCCCCC
THEAKRLCPELILVIGNNREYTRISKLIFEMLGQFTPLVEVFSIDEAFLDLTGSLRLFGR
HHHHHHHHHHEEEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEHHH
ADVIAREIKARIRDRFGLTCSIGIAPNKLLAKLASDMQKPDGLTIIPPENVASLMKTTPI
HHHHHHHHHHHHHHHCCCEEEECCCCHHHHHHHHHHHCCCCCEEEECCHHHHHHHHHCCH
RSLCGIGPSTEQRLKYLGISTCNDLGHFSSKILTRHFGAMGARLKQMGQGIDDSPVIPTT
HHHHCCCCCHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCC
TEEEVKSVSHSTTLDHDLTNKDDIHKYLLMLSEMVGRRARRYKTKGKTVTLTIRYADFTT
CHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEEEEEEECCCC
FSRQETLPSPLNRSGDIYRAVTALLDTLQLTQPIRLLGVAISNLVHASEQLPLFPEERRL
CCHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHH
TTLSQAMDQVNDRFGETTITFGTLLGQDNCSHVIAPAWRPAGIRDVKVK
HHHHHHHHHHHHHHCCCEEEEHHHHCCCCCCCEECCCCCCCCCEECCCC
>Mature Secondary Structure 
SNHRTILHLDMNAFFASVEQQADPSLQGKPVAVIGSGARTIITTASYEARAHGVGTGMT
CCCCEEEEEEHHHHHHHHHHHCCCCCCCCCEEEEECCCEEEEEECCCCHHHCCCCCCCC
THEAKRLCPELILVIGNNREYTRISKLIFEMLGQFTPLVEVFSIDEAFLDLTGSLRLFGR
HHHHHHHHHHEEEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEHHH
ADVIAREIKARIRDRFGLTCSIGIAPNKLLAKLASDMQKPDGLTIIPPENVASLMKTTPI
HHHHHHHHHHHHHHHCCCEEEECCCCHHHHHHHHHHHCCCCCEEEECCHHHHHHHHHCCH
RSLCGIGPSTEQRLKYLGISTCNDLGHFSSKILTRHFGAMGARLKQMGQGIDDSPVIPTT
HHHHCCCCCHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCC
TEEEVKSVSHSTTLDHDLTNKDDIHKYLLMLSEMVGRRARRYKTKGKTVTLTIRYADFTT
CHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEEEEEEECCCC
FSRQETLPSPLNRSGDIYRAVTALLDTLQLTQPIRLLGVAISNLVHASEQLPLFPEERRL
CCHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHH
TTLSQAMDQVNDRFGETTITFGTLLGQDNCSHVIAPAWRPAGIRDVKVK
HHHHHHHHHHHHHHCCCEEEEHHHHCCCCCCCEECCCCCCCCCEECCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA