| Definition | Frankia sp. EAN1pec chromosome, complete genome. |
|---|---|
| Accession | NC_009921 |
| Length | 8,982,042 |
Click here to switch to the map view.
The map label for this gene is dinB [H]
Identifier: 158316869
GI number: 158316869
Start: 6122551
End: 6123813
Strand: Reverse
Name: dinB [H]
Synonym: Franean1_5112
Alternate gene names: 158316869
Gene position: 6123813-6122551 (Counterclockwise)
Preceding gene: 158316870
Following gene: 158316868
Centisome position: 68.18
GC content: 75.85
Gene sequence:
>1263_bases GTGAAGCCCCCGCCGGAGCCCGCCCCACTGGAGCCCGGCGGGGCAGGGCCGTCCGACAGTCGGATCCTGCACGTCGACAT GGACGCCTTCTACGCCTCCATCGCGGTACGGGACGCACCCGAGCTACGGGGCCGGCCGGTGATCGTCGGCGGGGGGAGTC GGGGTGTGGTGCTCTCCGCGACCTACGAGGCTCGGGCCTTCGGGGTGCGCAGCGCCATGCCGATGGCGCGGGCCCGCGGG CTGTGCCCCACAGCGGTCGTCGTCCCCGCCGATCACGGCCGCTACCGCGAGGTCTCCCGTGCGATCATGGACGTCTTCCG GGACGTGACGCCGCTGGTCGCGCCGATCTCCCTCGACGAGGCGTTCCTCGACGTGGGCGGCGGGCGGCGGCTGTTCGGCA CCCCGGTCGACATCGCGCGGGCCATCCGCGGCCGGATCGCGACCGAACAGGATTTGACCTGCTCGGTGGGGGTGGCGCCG TCGATGTTCGTCGCGAAGATCGCCTCAGCCCGGTGCAAGCCGGACGGCCTGCTGGTGGTGCCCCCCGACGAGGTCCTCGC CTTCCTGCACCCGCTGCCGACCGCGGCGCTGTGGGGGGTCGGGCCGCGGACGGAGCAGGCGCTGACCCGGTTGGGGATAC GCACGATCGGCGACATTGCGCGCACGCCCGCCGACACGCTGCGGCGCGCCCTCGGAGCGGGCGCGGGCGGCCACCTGCAC GCGCTCGCGCACGGGCGGGACGACCGCCGCGTCGAGCCCGACGGCGTCGACGTGTCCGTCGGCGCCGAGGAGACCTTCTC CGCCGACCTGGCCGACCCCGAGCGGCTCGCCCGGGAGCTGCTCCGCCTCAGCGGGCGCGTCGCGGCCCGCCTGCGGGCCC GGGGCCAGGCCGGCCGCAACATCTCGATCAAGGTCCGGCATGCCGACTTCAGCACCGTCACGCGGGCTCGCACCCTCGCC GAGCCGACCGACGTCACCTGGGTGATCTACCGCACCGCGGGCGAGCTGTTCGACGAGCTCAGGGCCACATCCCGCCCGCT GGTGCGCCTGCTCGGGGTGCGGGCGGCCCGGCTGTCCGCCGCCGGGCGGACGAGCCACCAACTGGCGTTCGACGAGCGGC CGTCAGGCTGGGCCGAGGTCGACCGGGCCACCGACGGCGCCCGCCGGCGGTTCGGGGAGGAGTCCGTCCGGCCCGCGTCG CTGCTGCCCGACCGCCCGCGGCGCCCGGCTCCTCCCCGTGAGTGGGGGCCCGACCGAATGTGA
Upstream 100 bases:
>100_bases AGGACGGAACACCTGGCTGGTACGGGTCGCCGGGCTCTCGGTGGGCAGCCTCGCCGTCGGCCTGGTCATCGGGTTCCTGC TGCCGCGCTGACGGCCCGCG
Downstream 100 bases:
>100_bases ACCCGGTGTCCTGGAAGGCTCGAACGCCCCTGGAACGGCCGCGGCCACGATCACCGAACGGCATGATCGTACGATGAGCA TGGCATGAACCCCGCTGGCC
Product: DNA-directed DNA polymerase
Products: NA
Alternate protein names: Pol IV [H]
Number of amino acids: Translated: 420; Mature: 420
Protein sequence:
>420_residues MKPPPEPAPLEPGGAGPSDSRILHVDMDAFYASIAVRDAPELRGRPVIVGGGSRGVVLSATYEARAFGVRSAMPMARARG LCPTAVVVPADHGRYREVSRAIMDVFRDVTPLVAPISLDEAFLDVGGGRRLFGTPVDIARAIRGRIATEQDLTCSVGVAP SMFVAKIASARCKPDGLLVVPPDEVLAFLHPLPTAALWGVGPRTEQALTRLGIRTIGDIARTPADTLRRALGAGAGGHLH ALAHGRDDRRVEPDGVDVSVGAEETFSADLADPERLARELLRLSGRVAARLRARGQAGRNISIKVRHADFSTVTRARTLA EPTDVTWVIYRTAGELFDELRATSRPLVRLLGVRAARLSAAGRTSHQLAFDERPSGWAEVDRATDGARRRFGEESVRPAS LLPDRPRRPAPPREWGPDRM
Sequences:
>Translated_420_residues MKPPPEPAPLEPGGAGPSDSRILHVDMDAFYASIAVRDAPELRGRPVIVGGGSRGVVLSATYEARAFGVRSAMPMARARG LCPTAVVVPADHGRYREVSRAIMDVFRDVTPLVAPISLDEAFLDVGGGRRLFGTPVDIARAIRGRIATEQDLTCSVGVAP SMFVAKIASARCKPDGLLVVPPDEVLAFLHPLPTAALWGVGPRTEQALTRLGIRTIGDIARTPADTLRRALGAGAGGHLH ALAHGRDDRRVEPDGVDVSVGAEETFSADLADPERLARELLRLSGRVAARLRARGQAGRNISIKVRHADFSTVTRARTLA EPTDVTWVIYRTAGELFDELRATSRPLVRLLGVRAARLSAAGRTSHQLAFDERPSGWAEVDRATDGARRRFGEESVRPAS LLPDRPRRPAPPREWGPDRM >Mature_420_residues MKPPPEPAPLEPGGAGPSDSRILHVDMDAFYASIAVRDAPELRGRPVIVGGGSRGVVLSATYEARAFGVRSAMPMARARG LCPTAVVVPADHGRYREVSRAIMDVFRDVTPLVAPISLDEAFLDVGGGRRLFGTPVDIARAIRGRIATEQDLTCSVGVAP SMFVAKIASARCKPDGLLVVPPDEVLAFLHPLPTAALWGVGPRTEQALTRLGIRTIGDIARTPADTLRRALGAGAGGHLH ALAHGRDDRRVEPDGVDVSVGAEETFSADLADPERLARELLRLSGRVAARLRARGQAGRNISIKVRHADFSTVTRARTLA EPTDVTWVIYRTAGELFDELRATSRPLVRLLGVRAARLSAAGRTSHQLAFDERPSGWAEVDRATDGARRRFGEESVRPAS LLPDRPRRPAPPREWGPDRM
Specific function: Poorly processive, error-prone DNA polymerase involved in untargeted mutagenesis. Copies undamaged DNA at stalled replication forks, which arise in vivo from mismatched or misaligned primer ends. These misaligned primers can be extended by polIV. Exhibits
COG id: COG0389
COG function: function code L; Nucleotidyltransferase/DNA polymerase involved in DNA repair
Gene ontology:
Cell location: Cytoplasm [H]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 1 umuC domain [H]
Homologues:
Organism=Homo sapiens, GI84043967, Length=411, Percent_Identity=26.2773722627737, Blast_Score=159, Evalue=3e-39, Organism=Homo sapiens, GI7706681, Length=324, Percent_Identity=28.3950617283951, Blast_Score=144, Evalue=1e-34, Organism=Homo sapiens, GI154350220, Length=308, Percent_Identity=27.2727272727273, Blast_Score=117, Evalue=3e-26, Organism=Homo sapiens, GI7705344, Length=104, Percent_Identity=44.2307692307692, Blast_Score=107, Evalue=2e-23, Organism=Escherichia coli, GI1786425, Length=304, Percent_Identity=39.8026315789474, Blast_Score=191, Evalue=1e-49, Organism=Escherichia coli, GI1787432, Length=297, Percent_Identity=26.5993265993266, Blast_Score=101, Evalue=7e-23, Organism=Caenorhabditis elegans, GI193205700, Length=401, Percent_Identity=28.1795511221945, Blast_Score=132, Evalue=2e-31, Organism=Caenorhabditis elegans, GI193205702, Length=353, Percent_Identity=26.0623229461756, Blast_Score=93, Evalue=2e-19, Organism=Caenorhabditis elegans, GI17537959, Length=211, Percent_Identity=27.9620853080569, Blast_Score=91, Evalue=9e-19, Organism=Caenorhabditis elegans, GI115534089, Length=118, Percent_Identity=39.8305084745763, Blast_Score=79, Evalue=5e-15, Organism=Drosophila melanogaster, GI19923006, Length=471, Percent_Identity=23.5668789808917, Blast_Score=134, Evalue=1e-31, Organism=Drosophila melanogaster, GI21355641, Length=281, Percent_Identity=28.4697508896797, Blast_Score=114, Evalue=2e-25, Organism=Drosophila melanogaster, GI24644984, Length=281, Percent_Identity=28.4697508896797, Blast_Score=114, Evalue=2e-25, Organism=Drosophila melanogaster, GI24668444, Length=121, Percent_Identity=35.5371900826446, Blast_Score=71, Evalue=1e-12,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR017962 - InterPro: IPR017961 - InterPro: IPR001126 - InterPro: IPR017963 - InterPro: IPR022880 [H]
Pfam domain/function: PF00817 IMS [H]
EC number: =2.7.7.7 [H]
Molecular weight: Translated: 45180; Mature: 45180
Theoretical pI: Translated: 10.73; Mature: 10.73
Prosite motif: PS50173 UMUC
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.7 %Cys (Translated Protein) 1.7 %Met (Translated Protein) 2.4 %Cys+Met (Translated Protein) 0.7 %Cys (Mature Protein) 1.7 %Met (Mature Protein) 2.4 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MKPPPEPAPLEPGGAGPSDSRILHVDMDAFYASIAVRDAPELRGRPVIVGGGSRGVVLSA CCCCCCCCCCCCCCCCCCCCEEEEEEHHHHHHHHHCCCCHHHCCCEEEEECCCCCEEEEE TYEARAFGVRSAMPMARARGLCPTAVVVPADHGRYREVSRAIMDVFRDVTPLVAPISLDE EHHHHHHHHHHHCHHHHHCCCCCEEEEEECCCCHHHHHHHHHHHHHHHHHHHEECCCCCH AFLDVGGGRRLFGTPVDIARAIRGRIATEQDLTCSVGVAPSMFVAKIASARCKPDGLLVV HHHHCCCCCEECCCHHHHHHHHHHCCCCCCCCEEECCCCHHHHHHHHHHCCCCCCCEEEE PPDEVLAFLHPLPTAALWGVGPRTEQALTRLGIRTIGDIARTPADTLRRALGAGAGGHLH CHHHHHHHHHCCCHHHHCCCCCCHHHHHHHHHHHHHHHHHCCCHHHHHHHHCCCCCCCEE ALAHGRDDRRVEPDGVDVSVGAEETFSADLADPERLARELLRLSGRVAARLRARGQAGRN EEECCCCCCCCCCCCCEEECCCCHHCCCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCC ISIKVRHADFSTVTRARTLAEPTDVTWVIYRTAGELFDELRATSRPLVRLLGVRAARLSA EEEEEEECCHHHHHHHHHHCCCCCEEEEEEHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH AGRTSHQLAFDERPSGWAEVDRATDGARRRFGEESVRPASLLPDRPRRPAPPREWGPDRM CCCCCCCEEECCCCCCHHHHHHHCCHHHHHCCHHCCCCHHCCCCCCCCCCCCCCCCCCCC >Mature Secondary Structure MKPPPEPAPLEPGGAGPSDSRILHVDMDAFYASIAVRDAPELRGRPVIVGGGSRGVVLSA CCCCCCCCCCCCCCCCCCCCEEEEEEHHHHHHHHHCCCCHHHCCCEEEEECCCCCEEEEE TYEARAFGVRSAMPMARARGLCPTAVVVPADHGRYREVSRAIMDVFRDVTPLVAPISLDE EHHHHHHHHHHHCHHHHHCCCCCEEEEEECCCCHHHHHHHHHHHHHHHHHHHEECCCCCH AFLDVGGGRRLFGTPVDIARAIRGRIATEQDLTCSVGVAPSMFVAKIASARCKPDGLLVV HHHHCCCCCEECCCHHHHHHHHHHCCCCCCCCEEECCCCHHHHHHHHHHCCCCCCCEEEE PPDEVLAFLHPLPTAALWGVGPRTEQALTRLGIRTIGDIARTPADTLRRALGAGAGGHLH CHHHHHHHHHCCCHHHHCCCCCCHHHHHHHHHHHHHHHHHCCCHHHHHHHHCCCCCCCEE ALAHGRDDRRVEPDGVDVSVGAEETFSADLADPERLARELLRLSGRVAARLRARGQAGRN EEECCCCCCCCCCCCCEEECCCCHHCCCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCC ISIKVRHADFSTVTRARTLAEPTDVTWVIYRTAGELFDELRATSRPLVRLLGVRAARLSA EEEEEEECCHHHHHHHHHHCCCCCEEEEEEHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH AGRTSHQLAFDERPSGWAEVDRATDGARRRFGEESVRPASLLPDRPRRPAPPREWGPDRM CCCCCCCEEECCCCCCHHHHHHHCCHHHHHCCHHCCCCHHCCCCCCCCCCCCCCCCCCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: NA