Definition Frankia sp. EAN1pec chromosome, complete genome.
Accession NC_009921
Length 8,982,042

Click here to switch to the map view.

The map label for this gene is dinB [H]

Identifier: 158316869

GI number: 158316869

Start: 6122551

End: 6123813

Strand: Reverse

Name: dinB [H]

Synonym: Franean1_5112

Alternate gene names: 158316869

Gene position: 6123813-6122551 (Counterclockwise)

Preceding gene: 158316870

Following gene: 158316868

Centisome position: 68.18

GC content: 75.85

Gene sequence:

>1263_bases
GTGAAGCCCCCGCCGGAGCCCGCCCCACTGGAGCCCGGCGGGGCAGGGCCGTCCGACAGTCGGATCCTGCACGTCGACAT
GGACGCCTTCTACGCCTCCATCGCGGTACGGGACGCACCCGAGCTACGGGGCCGGCCGGTGATCGTCGGCGGGGGGAGTC
GGGGTGTGGTGCTCTCCGCGACCTACGAGGCTCGGGCCTTCGGGGTGCGCAGCGCCATGCCGATGGCGCGGGCCCGCGGG
CTGTGCCCCACAGCGGTCGTCGTCCCCGCCGATCACGGCCGCTACCGCGAGGTCTCCCGTGCGATCATGGACGTCTTCCG
GGACGTGACGCCGCTGGTCGCGCCGATCTCCCTCGACGAGGCGTTCCTCGACGTGGGCGGCGGGCGGCGGCTGTTCGGCA
CCCCGGTCGACATCGCGCGGGCCATCCGCGGCCGGATCGCGACCGAACAGGATTTGACCTGCTCGGTGGGGGTGGCGCCG
TCGATGTTCGTCGCGAAGATCGCCTCAGCCCGGTGCAAGCCGGACGGCCTGCTGGTGGTGCCCCCCGACGAGGTCCTCGC
CTTCCTGCACCCGCTGCCGACCGCGGCGCTGTGGGGGGTCGGGCCGCGGACGGAGCAGGCGCTGACCCGGTTGGGGATAC
GCACGATCGGCGACATTGCGCGCACGCCCGCCGACACGCTGCGGCGCGCCCTCGGAGCGGGCGCGGGCGGCCACCTGCAC
GCGCTCGCGCACGGGCGGGACGACCGCCGCGTCGAGCCCGACGGCGTCGACGTGTCCGTCGGCGCCGAGGAGACCTTCTC
CGCCGACCTGGCCGACCCCGAGCGGCTCGCCCGGGAGCTGCTCCGCCTCAGCGGGCGCGTCGCGGCCCGCCTGCGGGCCC
GGGGCCAGGCCGGCCGCAACATCTCGATCAAGGTCCGGCATGCCGACTTCAGCACCGTCACGCGGGCTCGCACCCTCGCC
GAGCCGACCGACGTCACCTGGGTGATCTACCGCACCGCGGGCGAGCTGTTCGACGAGCTCAGGGCCACATCCCGCCCGCT
GGTGCGCCTGCTCGGGGTGCGGGCGGCCCGGCTGTCCGCCGCCGGGCGGACGAGCCACCAACTGGCGTTCGACGAGCGGC
CGTCAGGCTGGGCCGAGGTCGACCGGGCCACCGACGGCGCCCGCCGGCGGTTCGGGGAGGAGTCCGTCCGGCCCGCGTCG
CTGCTGCCCGACCGCCCGCGGCGCCCGGCTCCTCCCCGTGAGTGGGGGCCCGACCGAATGTGA

Upstream 100 bases:

>100_bases
AGGACGGAACACCTGGCTGGTACGGGTCGCCGGGCTCTCGGTGGGCAGCCTCGCCGTCGGCCTGGTCATCGGGTTCCTGC
TGCCGCGCTGACGGCCCGCG

Downstream 100 bases:

>100_bases
ACCCGGTGTCCTGGAAGGCTCGAACGCCCCTGGAACGGCCGCGGCCACGATCACCGAACGGCATGATCGTACGATGAGCA
TGGCATGAACCCCGCTGGCC

Product: DNA-directed DNA polymerase

Products: NA

Alternate protein names: Pol IV [H]

Number of amino acids: Translated: 420; Mature: 420

Protein sequence:

>420_residues
MKPPPEPAPLEPGGAGPSDSRILHVDMDAFYASIAVRDAPELRGRPVIVGGGSRGVVLSATYEARAFGVRSAMPMARARG
LCPTAVVVPADHGRYREVSRAIMDVFRDVTPLVAPISLDEAFLDVGGGRRLFGTPVDIARAIRGRIATEQDLTCSVGVAP
SMFVAKIASARCKPDGLLVVPPDEVLAFLHPLPTAALWGVGPRTEQALTRLGIRTIGDIARTPADTLRRALGAGAGGHLH
ALAHGRDDRRVEPDGVDVSVGAEETFSADLADPERLARELLRLSGRVAARLRARGQAGRNISIKVRHADFSTVTRARTLA
EPTDVTWVIYRTAGELFDELRATSRPLVRLLGVRAARLSAAGRTSHQLAFDERPSGWAEVDRATDGARRRFGEESVRPAS
LLPDRPRRPAPPREWGPDRM

Sequences:

>Translated_420_residues
MKPPPEPAPLEPGGAGPSDSRILHVDMDAFYASIAVRDAPELRGRPVIVGGGSRGVVLSATYEARAFGVRSAMPMARARG
LCPTAVVVPADHGRYREVSRAIMDVFRDVTPLVAPISLDEAFLDVGGGRRLFGTPVDIARAIRGRIATEQDLTCSVGVAP
SMFVAKIASARCKPDGLLVVPPDEVLAFLHPLPTAALWGVGPRTEQALTRLGIRTIGDIARTPADTLRRALGAGAGGHLH
ALAHGRDDRRVEPDGVDVSVGAEETFSADLADPERLARELLRLSGRVAARLRARGQAGRNISIKVRHADFSTVTRARTLA
EPTDVTWVIYRTAGELFDELRATSRPLVRLLGVRAARLSAAGRTSHQLAFDERPSGWAEVDRATDGARRRFGEESVRPAS
LLPDRPRRPAPPREWGPDRM
>Mature_420_residues
MKPPPEPAPLEPGGAGPSDSRILHVDMDAFYASIAVRDAPELRGRPVIVGGGSRGVVLSATYEARAFGVRSAMPMARARG
LCPTAVVVPADHGRYREVSRAIMDVFRDVTPLVAPISLDEAFLDVGGGRRLFGTPVDIARAIRGRIATEQDLTCSVGVAP
SMFVAKIASARCKPDGLLVVPPDEVLAFLHPLPTAALWGVGPRTEQALTRLGIRTIGDIARTPADTLRRALGAGAGGHLH
ALAHGRDDRRVEPDGVDVSVGAEETFSADLADPERLARELLRLSGRVAARLRARGQAGRNISIKVRHADFSTVTRARTLA
EPTDVTWVIYRTAGELFDELRATSRPLVRLLGVRAARLSAAGRTSHQLAFDERPSGWAEVDRATDGARRRFGEESVRPAS
LLPDRPRRPAPPREWGPDRM

Specific function: Poorly processive, error-prone DNA polymerase involved in untargeted mutagenesis. Copies undamaged DNA at stalled replication forks, which arise in vivo from mismatched or misaligned primer ends. These misaligned primers can be extended by polIV. Exhibits

COG id: COG0389

COG function: function code L; Nucleotidyltransferase/DNA polymerase involved in DNA repair

Gene ontology:

Cell location: Cytoplasm [H]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 umuC domain [H]

Homologues:

Organism=Homo sapiens, GI84043967, Length=411, Percent_Identity=26.2773722627737, Blast_Score=159, Evalue=3e-39,
Organism=Homo sapiens, GI7706681, Length=324, Percent_Identity=28.3950617283951, Blast_Score=144, Evalue=1e-34,
Organism=Homo sapiens, GI154350220, Length=308, Percent_Identity=27.2727272727273, Blast_Score=117, Evalue=3e-26,
Organism=Homo sapiens, GI7705344, Length=104, Percent_Identity=44.2307692307692, Blast_Score=107, Evalue=2e-23,
Organism=Escherichia coli, GI1786425, Length=304, Percent_Identity=39.8026315789474, Blast_Score=191, Evalue=1e-49,
Organism=Escherichia coli, GI1787432, Length=297, Percent_Identity=26.5993265993266, Blast_Score=101, Evalue=7e-23,
Organism=Caenorhabditis elegans, GI193205700, Length=401, Percent_Identity=28.1795511221945, Blast_Score=132, Evalue=2e-31,
Organism=Caenorhabditis elegans, GI193205702, Length=353, Percent_Identity=26.0623229461756, Blast_Score=93, Evalue=2e-19,
Organism=Caenorhabditis elegans, GI17537959, Length=211, Percent_Identity=27.9620853080569, Blast_Score=91, Evalue=9e-19,
Organism=Caenorhabditis elegans, GI115534089, Length=118, Percent_Identity=39.8305084745763, Blast_Score=79, Evalue=5e-15,
Organism=Drosophila melanogaster, GI19923006, Length=471, Percent_Identity=23.5668789808917, Blast_Score=134, Evalue=1e-31,
Organism=Drosophila melanogaster, GI21355641, Length=281, Percent_Identity=28.4697508896797, Blast_Score=114, Evalue=2e-25,
Organism=Drosophila melanogaster, GI24644984, Length=281, Percent_Identity=28.4697508896797, Blast_Score=114, Evalue=2e-25,
Organism=Drosophila melanogaster, GI24668444, Length=121, Percent_Identity=35.5371900826446, Blast_Score=71, Evalue=1e-12,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR017962
- InterPro:   IPR017961
- InterPro:   IPR001126
- InterPro:   IPR017963
- InterPro:   IPR022880 [H]

Pfam domain/function: PF00817 IMS [H]

EC number: =2.7.7.7 [H]

Molecular weight: Translated: 45180; Mature: 45180

Theoretical pI: Translated: 10.73; Mature: 10.73

Prosite motif: PS50173 UMUC

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.7 %Cys     (Translated Protein)
1.7 %Met     (Translated Protein)
2.4 %Cys+Met (Translated Protein)
0.7 %Cys     (Mature Protein)
1.7 %Met     (Mature Protein)
2.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKPPPEPAPLEPGGAGPSDSRILHVDMDAFYASIAVRDAPELRGRPVIVGGGSRGVVLSA
CCCCCCCCCCCCCCCCCCCCEEEEEEHHHHHHHHHCCCCHHHCCCEEEEECCCCCEEEEE
TYEARAFGVRSAMPMARARGLCPTAVVVPADHGRYREVSRAIMDVFRDVTPLVAPISLDE
EHHHHHHHHHHHCHHHHHCCCCCEEEEEECCCCHHHHHHHHHHHHHHHHHHHEECCCCCH
AFLDVGGGRRLFGTPVDIARAIRGRIATEQDLTCSVGVAPSMFVAKIASARCKPDGLLVV
HHHHCCCCCEECCCHHHHHHHHHHCCCCCCCCEEECCCCHHHHHHHHHHCCCCCCCEEEE
PPDEVLAFLHPLPTAALWGVGPRTEQALTRLGIRTIGDIARTPADTLRRALGAGAGGHLH
CHHHHHHHHHCCCHHHHCCCCCCHHHHHHHHHHHHHHHHHCCCHHHHHHHHCCCCCCCEE
ALAHGRDDRRVEPDGVDVSVGAEETFSADLADPERLARELLRLSGRVAARLRARGQAGRN
EEECCCCCCCCCCCCCEEECCCCHHCCCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCC
ISIKVRHADFSTVTRARTLAEPTDVTWVIYRTAGELFDELRATSRPLVRLLGVRAARLSA
EEEEEEECCHHHHHHHHHHCCCCCEEEEEEHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
AGRTSHQLAFDERPSGWAEVDRATDGARRRFGEESVRPASLLPDRPRRPAPPREWGPDRM
CCCCCCCEEECCCCCCHHHHHHHCCHHHHHCCHHCCCCHHCCCCCCCCCCCCCCCCCCCC
>Mature Secondary Structure
MKPPPEPAPLEPGGAGPSDSRILHVDMDAFYASIAVRDAPELRGRPVIVGGGSRGVVLSA
CCCCCCCCCCCCCCCCCCCCEEEEEEHHHHHHHHHCCCCHHHCCCEEEEECCCCCEEEEE
TYEARAFGVRSAMPMARARGLCPTAVVVPADHGRYREVSRAIMDVFRDVTPLVAPISLDE
EHHHHHHHHHHHCHHHHHCCCCCEEEEEECCCCHHHHHHHHHHHHHHHHHHHEECCCCCH
AFLDVGGGRRLFGTPVDIARAIRGRIATEQDLTCSVGVAPSMFVAKIASARCKPDGLLVV
HHHHCCCCCEECCCHHHHHHHHHHCCCCCCCCEEECCCCHHHHHHHHHHCCCCCCCEEEE
PPDEVLAFLHPLPTAALWGVGPRTEQALTRLGIRTIGDIARTPADTLRRALGAGAGGHLH
CHHHHHHHHHCCCHHHHCCCCCCHHHHHHHHHHHHHHHHHCCCHHHHHHHHCCCCCCCEE
ALAHGRDDRRVEPDGVDVSVGAEETFSADLADPERLARELLRLSGRVAARLRARGQAGRN
EEECCCCCCCCCCCCCEEECCCCHHCCCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCC
ISIKVRHADFSTVTRARTLAEPTDVTWVIYRTAGELFDELRATSRPLVRLLGVRAARLSA
EEEEEEECCHHHHHHHHHHCCCCCEEEEEEHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
AGRTSHQLAFDERPSGWAEVDRATDGARRRFGEESVRPASLLPDRPRRPAPPREWGPDRM
CCCCCCCEEECCCCCCHHHHHHHCCHHHHHCCHHCCCCHHCCCCCCCCCCCCCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA