Definition Sulfolobus solfataricus P2 chromosome, complete genome.
Accession NC_002754
Length 2,992,245

Click here to switch to the map view.

The map label for this gene is dpo2 [H]

Identifier: 15898291

GI number: 15898291

Start: 1315750

End: 1317435

Strand: Reverse

Name: dpo2 [H]

Synonym: SSO1459

Alternate gene names: 15898291

Gene position: 1317435-1315750 (Counterclockwise)

Preceding gene: 15898292

Following gene: 15898290

Centisome position: 44.03

GC content: 38.43

Gene sequence:

>1686_bases
TTGGGCTTTGGCGGAGGAATGCGAGAAATGGAGGAGTACGTACTTGACGCTTATCCAATCAAGGGAGGAGTGAAACTATT
CCTAAGCAATTTCAAGGAGAAAACTATCAGAACAACCTTCCCAGTTTACACCATAACAGATAACCCAGATATAGTACTAC
AGCACCCAGAGGTGAGATATTACGAAAAGGAAAAGTGGAAAACGTTAGATGGGAAAGAGGTTAAGGTTTATCGCTTTGAG
GTAGAATCCCTTGACGCTTATTATTACATGAGGAAAAGGTTAAACGTCGTGAACGAAACACCAACAGTACTATCTCAAAC
GCTATACCGCCTAGGGATAAAACCATTTAGGAGATTTCGCTCTTCTGATGATGAATTTCCAAAGGTAACCATTGCAAGAG
TTGTACCCTTGGATTGGTACGGTGAATCGTTAAAAGGGAAAGTGTTTGAAGTTAAAATAAATAACGAGGTTAGGAGATTT
TACGAAAAGCCTGAAGTTGAGGTCGATATCGCTGAATGTTTAGGAGAAGCCTGCAATTACGTAAAGTCAAACGTTAAGAT
TAGAATTGAGAAGAAGAGGTCCCCAGTTTCGGCAAAGGGATTAATAGAGTGGTCCTTTATTTCGCTTACACCAATTCACG
AAATAGCCTATGCCACTATTGGTAAAGTGTTAACAATAAATGAAGCGTGGGTCGCATTTAAGAGAAGAATTATCATACCT
AAAGTTGTTCCTAGAGTTGAGAAATTGAGAAGATTAGAGGATATAATGATGGTGGATAAGGGTGGGCTAATACTCTTCCC
ACAGCCCGGATGTTATGATAATGTTTATCAAGTTGACTTCTCTTCAATGTATCCCTCCTTAATTGTAAAGCATAATATTT
CAGCTGAAACCGTTGAAGCATGTGATGATATAAAAACTGAGTTGCACTCAATTTGCTTAAAGGAAAAGGGAATTATACCA
GAAGCCTTACAGTGGTTGATAGAGAGAAAATCGGAATTGAAGAAAATTGACGAAGAGAGAGCTGAGGCAATAAAGTGGAT
TTTAGTAGCCTCTTTTGGCTATCTAGGTTATAGGAATTCCTTGTTTGGAAAGATTGAGGCATACGAAATGGTCACATATT
TAGCTAGGAAAACGTTAAGGAGAACAATGGAGATTGCTGAGGAGATGGGGTTAAGGGTTTTACATGGTATAATAGATTCA
CTGGTTGTTAAGGGTGATAACGTTGATAAATTCATTGAGAAAGTCGAGAAAGAAACGGGGTTAAGACTGGATTATAAACG
TTACAATTGGATTATCTTCACTATTACCAGAAACAATACACCATATCCTACAAGATATATTGCAAACATGAACGGTGAAA
TGATAGCTAAGGGACTAATAAGGGAGAACATGCCCAATATCGTTAAATCGTTTTTGGAAGACGTGCTAAGGGAGTTCTCA
TCAGCTAAGACTTGTTCTGACGTTAAAAAGCTTAGGATTAGGGATTTATTCGAGCATTATAGAAAGAGGGCTATAAACGG
TGAGCCAATAGATTACGTAATATGGATTAAGGACGTTCCTTACGTAAGGGGAATTAAGGGATTTTATGAGGCTAGGCTAG
GTTATATGGGAAGGGACGTAAATTACTACATCAATTACTTGAAGAGGGTTTATGAAGACGTGGAAGAGGTGATGTCTAGG
TGTTAA

Upstream 100 bases:

>100_bases
CCCTTTTACTAGAAAGGGTTAAGGAAAAAGTAAGGTATACTCAAAGTGCATCATATGACGAACTGGTTGATCCCTATAAC
CTAGTTTACTTTGCGCTAAT

Downstream 100 bases:

>100_bases
CTACTGGCTTTCCCTTTTTAGACGAGATAATAAAGAGGGATGAAATTGTGGAGTTCTTCTCAACTGATAACGATTTGTTA
AGAACGTTCTATCATAGAGT

Product: DNA polymerase II (DNA polymerase B2) carboxy-end (dpo2)

Products: NA

Alternate protein names: DNA polymerase B2; DNA polymerase II [H]

Number of amino acids: Translated: 561; Mature: 560

Protein sequence:

>561_residues
MGFGGGMREMEEYVLDAYPIKGGVKLFLSNFKEKTIRTTFPVYTITDNPDIVLQHPEVRYYEKEKWKTLDGKEVKVYRFE
VESLDAYYYMRKRLNVVNETPTVLSQTLYRLGIKPFRRFRSSDDEFPKVTIARVVPLDWYGESLKGKVFEVKINNEVRRF
YEKPEVEVDIAECLGEACNYVKSNVKIRIEKKRSPVSAKGLIEWSFISLTPIHEIAYATIGKVLTINEAWVAFKRRIIIP
KVVPRVEKLRRLEDIMMVDKGGLILFPQPGCYDNVYQVDFSSMYPSLIVKHNISAETVEACDDIKTELHSICLKEKGIIP
EALQWLIERKSELKKIDEERAEAIKWILVASFGYLGYRNSLFGKIEAYEMVTYLARKTLRRTMEIAEEMGLRVLHGIIDS
LVVKGDNVDKFIEKVEKETGLRLDYKRYNWIIFTITRNNTPYPTRYIANMNGEMIAKGLIRENMPNIVKSFLEDVLREFS
SAKTCSDVKKLRIRDLFEHYRKRAINGEPIDYVIWIKDVPYVRGIKGFYEARLGYMGRDVNYYINYLKRVYEDVEEVMSR
C

Sequences:

>Translated_561_residues
MGFGGGMREMEEYVLDAYPIKGGVKLFLSNFKEKTIRTTFPVYTITDNPDIVLQHPEVRYYEKEKWKTLDGKEVKVYRFE
VESLDAYYYMRKRLNVVNETPTVLSQTLYRLGIKPFRRFRSSDDEFPKVTIARVVPLDWYGESLKGKVFEVKINNEVRRF
YEKPEVEVDIAECLGEACNYVKSNVKIRIEKKRSPVSAKGLIEWSFISLTPIHEIAYATIGKVLTINEAWVAFKRRIIIP
KVVPRVEKLRRLEDIMMVDKGGLILFPQPGCYDNVYQVDFSSMYPSLIVKHNISAETVEACDDIKTELHSICLKEKGIIP
EALQWLIERKSELKKIDEERAEAIKWILVASFGYLGYRNSLFGKIEAYEMVTYLARKTLRRTMEIAEEMGLRVLHGIIDS
LVVKGDNVDKFIEKVEKETGLRLDYKRYNWIIFTITRNNTPYPTRYIANMNGEMIAKGLIRENMPNIVKSFLEDVLREFS
SAKTCSDVKKLRIRDLFEHYRKRAINGEPIDYVIWIKDVPYVRGIKGFYEARLGYMGRDVNYYINYLKRVYEDVEEVMSR
C
>Mature_560_residues
GFGGGMREMEEYVLDAYPIKGGVKLFLSNFKEKTIRTTFPVYTITDNPDIVLQHPEVRYYEKEKWKTLDGKEVKVYRFEV
ESLDAYYYMRKRLNVVNETPTVLSQTLYRLGIKPFRRFRSSDDEFPKVTIARVVPLDWYGESLKGKVFEVKINNEVRRFY
EKPEVEVDIAECLGEACNYVKSNVKIRIEKKRSPVSAKGLIEWSFISLTPIHEIAYATIGKVLTINEAWVAFKRRIIIPK
VVPRVEKLRRLEDIMMVDKGGLILFPQPGCYDNVYQVDFSSMYPSLIVKHNISAETVEACDDIKTELHSICLKEKGIIPE
ALQWLIERKSELKKIDEERAEAIKWILVASFGYLGYRNSLFGKIEAYEMVTYLARKTLRRTMEIAEEMGLRVLHGIIDSL
VVKGDNVDKFIEKVEKETGLRLDYKRYNWIIFTITRNNTPYPTRYIANMNGEMIAKGLIRENMPNIVKSFLEDVLREFSS
AKTCSDVKKLRIRDLFEHYRKRAINGEPIDYVIWIKDVPYVRGIKGFYEARLGYMGRDVNYYINYLKRVYEDVEEVMSRC

Specific function: This polymerase is devoid of exonuclease activity [H]

COG id: COG0417

COG function: function code L; DNA polymerase elongation subunit (family B)

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the DNA polymerase type-B family [H]

Homologues:

Organism=Homo sapiens, GI106507301, Length=175, Percent_Identity=30.2857142857143, Blast_Score=72, Evalue=1e-12,
Organism=Caenorhabditis elegans, GI32565317, Length=163, Percent_Identity=29.4478527607362, Blast_Score=71, Evalue=1e-12,
Organism=Saccharomyces cerevisiae, GI6324227, Length=192, Percent_Identity=31.25, Blast_Score=81, Evalue=5e-16,
Organism=Drosophila melanogaster, GI24648780, Length=193, Percent_Identity=29.5336787564767, Blast_Score=75, Evalue=1e-13,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR006172
- InterPro:   IPR006134
- InterPro:   IPR023211 [H]

Pfam domain/function: PF00136 DNA_pol_B [H]

EC number: =2.7.7.7 [H]

Molecular weight: Translated: 65716; Mature: 65585

Theoretical pI: Translated: 9.15; Mature: 9.15

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.2 %Cys     (Translated Protein)
2.7 %Met     (Translated Protein)
3.9 %Cys+Met (Translated Protein)
1.2 %Cys     (Mature Protein)
2.5 %Met     (Mature Protein)
3.8 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MGFGGGMREMEEYVLDAYPIKGGVKLFLSNFKEKTIRTTFPVYTITDNPDIVLQHPEVRY
CCCCCCHHHHHHHHHHCCCCCCHHHHHHHHHHHHHEEEECCEEEECCCCCEEEECCCCCE
YEKEKWKTLDGKEVKVYRFEVESLDAYYYMRKRLNVVNETPTVLSQTLYRLGIKPFRRFR
EHHHHCCCCCCCEEEEEEEEHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHCCHHHHHHC
SSDDEFPKVTIARVVPLDWYGESLKGKVFEVKINNEVRRFYEKPEVEVDIAECLGEACNY
CCCCCCCCEEEEEEEECCCCCCCCCCEEEEEEECHHHHHHHHCCCCEEEHHHHHHHHHHH
VKSNVKIRIEKKRSPVSAKGLIEWSFISLTPIHEIAYATIGKVLTINEAWVAFKRRIIIP
HHCCCEEEEECCCCCCCCCCEEEEEEEEECHHHHHHHHHHCCEEEECHHHHHHHHHCCCH
KVVPRVEKLRRLEDIMMVDKGGLILFPQPGCYDNVYQVDFSSMYPSLIVKHNISAETVEA
HHHHHHHHHHHHHHHHEECCCCEEEECCCCCCCCEEEEEHHHHCCHHHEECCCCHHHHHH
CDDIKTELHSICLKEKGIIPEALQWLIERKSELKKIDEERAEAIKWILVASFGYLGYRNS
HHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCH
LFGKIEAYEMVTYLARKTLRRTMEIAEEMGLRVLHGIIDSLVVKGDNVDKFIEKVEKETG
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHCC
LRLDYKRYNWIIFTITRNNTPYPTRYIANMNGEMIAKGLIRENMPNIVKSFLEDVLREFS
CEEEEEEEEEEEEEEECCCCCCCCEEEECCCHHHHHHHHHHCCCHHHHHHHHHHHHHHHH
SAKTCSDVKKLRIRDLFEHYRKRAINGEPIDYVIWIKDVPYVRGIKGFYEARLGYMGRDV
CCCHHHHHHHHHHHHHHHHHHHHCCCCCCCEEEEEEECCCHHHHHHHHHHHHHHHCCCHH
NYYINYLKRVYEDVEEVMSRC
HHHHHHHHHHHHHHHHHHHCC
>Mature Secondary Structure 
GFGGGMREMEEYVLDAYPIKGGVKLFLSNFKEKTIRTTFPVYTITDNPDIVLQHPEVRY
CCCCCHHHHHHHHHHCCCCCCHHHHHHHHHHHHHEEEECCEEEECCCCCEEEECCCCCE
YEKEKWKTLDGKEVKVYRFEVESLDAYYYMRKRLNVVNETPTVLSQTLYRLGIKPFRRFR
EHHHHCCCCCCCEEEEEEEEHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHCCHHHHHHC
SSDDEFPKVTIARVVPLDWYGESLKGKVFEVKINNEVRRFYEKPEVEVDIAECLGEACNY
CCCCCCCCEEEEEEEECCCCCCCCCCEEEEEEECHHHHHHHHCCCCEEEHHHHHHHHHHH
VKSNVKIRIEKKRSPVSAKGLIEWSFISLTPIHEIAYATIGKVLTINEAWVAFKRRIIIP
HHCCCEEEEECCCCCCCCCCEEEEEEEEECHHHHHHHHHHCCEEEECHHHHHHHHHCCCH
KVVPRVEKLRRLEDIMMVDKGGLILFPQPGCYDNVYQVDFSSMYPSLIVKHNISAETVEA
HHHHHHHHHHHHHHHHEECCCCEEEECCCCCCCCEEEEEHHHHCCHHHEECCCCHHHHHH
CDDIKTELHSICLKEKGIIPEALQWLIERKSELKKIDEERAEAIKWILVASFGYLGYRNS
HHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCH
LFGKIEAYEMVTYLARKTLRRTMEIAEEMGLRVLHGIIDSLVVKGDNVDKFIEKVEKETG
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHCC
LRLDYKRYNWIIFTITRNNTPYPTRYIANMNGEMIAKGLIRENMPNIVKSFLEDVLREFS
CEEEEEEEEEEEEEEECCCCCCCCEEEECCCHHHHHHHHHHCCCHHHHHHHHHHHHHHHH
SAKTCSDVKKLRIRDLFEHYRKRAINGEPIDYVIWIKDVPYVRGIKGFYEARLGYMGRDV
CCCHHHHHHHHHHHHHHHHHHHHCCCCCCCEEEEEEECCCHHHHHHHHHHHHHHHCCCHH
NYYINYLKRVYEDVEEVMSRC
HHHHHHHHHHHHHHHHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 8332474; 11427726 [H]