The gene/protein map for NC_003106 is currently unavailable.
Definition Sulfolobus tokodaii str. 7 chromosome, complete genome.
Accession NC_003106
Length 2,694,756

Click here to switch to the map view.

The map label for this gene is pol-alpha [H]

Identifier: 15921715

GI number: 15921715

Start: 1429820

End: 1432450

Strand: Direct

Name: pol-alpha [H]

Synonym: ST1426

Alternate gene names: 15921715

Gene position: 1429820-1432450 (Clockwise)

Preceding gene: 15921714

Following gene: 15921719

Centisome position: 53.06

GC content: 30.9

Gene sequence:

>2631_bases
ATGGCAAGACAAATTACACTTTTTGATTTTACATTGAAGAAAGAACAAAATAAGGATGAAAGTAGAAAAGAAGAGATCCC
GCACGCTAATATCAACGAAGAGAGGAGAAAACCTAAGGAGTGGATAAAGGAGGCTGAAGAAGGGAAGAGTTATTTCTTAC
TTCAAGTTGATTATGATGGCAAAAAATCAAAAGCTGTTTGCAAACTCTATGACAAGGAGACGAAAAAAATATACATATTA
TATGATAATACAGGCCATAAACCTTATTTTCTTACTGATATAGACCCAGAAAAAGTTAATAAAATTCCTAAAGTTGTAAG
AGATCCTTCTTTTGATCATTTGGAAACAGTAATTAAGATAGACCCTTATTCTGGTAATAAGATAAAACTTACAAAAATAG
TTGTAAAAGACCCATTAGCTGTAAGAAGGATGAGAAACTCTGTTCCAAAAGCTTACGAAGCTCATATCAAATATTTTAAC
AATTATATCTATGATTTAGGCCTTATACCAGGTTTGCCTTATGTAGTGAAAAAAGGGAAATTAGAGCAAGTAAGACCAGA
ACTTAAAGGAGAAGAAGTAGATGAGATAAGAAAAGCTTTTGCTGATTCTGATGAAATGACTAAAGAAGCCGTTAACGATT
GGATTCCTATTTTTGAATCTGAAGTTCCTGATGTGAAAAGAGTAGCAATAGATATAGAAGTATATACTCCTATTAAGGGA
CGAATTCCAGATCCAGAGAAAGCAGAATTTCCTATAATAAGCATATCCCTAGCTGGGAATGATGGTACTAAAAGAGTTCT
AGTCCTACTTAGGGAGGATGTAAATTCTCAAATTACTAAGCACGATGTGATTGTAGAAACATTTAAATCTGAAAGAGAAT
TAATTAGAAGATTTTTCGATATAATTCTTGATTATCCAATTATACTGACATTTAATGGTGATGATTTCGATATTCCATAT
ATTTATTATAGGGCTTTAAAGCTTAATTTTACCCCAGAAGAAATACCATTTGATATAATAAATGATGAGGGAAAATATTT
AGCAGGTATTCATATAGATTTATATAAATTTTTCTTTAATAGAGCAATAAGAAATTATGCATTTGAAGGAAAATATAATG
AGTATAATCTAGATGCAGTAGCCACAGCACTATTAGGAATGTCTAAAGTTAAGCTTGATACATTAATCAGTTTCTTAGAT
CTTGATAAACTGATAGAATATAATTCAAGAGATGCTGAAATAACTCTTAAATTAACTACATTTAATAATAATTTGGTATG
GAAATTAATTATATTATTAGCAAGAATATCAAAGATGGGATTAGAGGAATTAACTAGAACTGAAGTTTCTACTTGGATTA
AAAACTTATATTATTGGGAACATAGGAGAAGAAACTGGCTTATTCCATTAAAAGAAGAAATACTAACTAGATCAAGTCAG
ATTAAGACTGCAGCTATAATAAAAGGGAAGAGGTATAAGGGTGCTGTAGTAATTGATCCACCAGCTGGTGTTTTCTTTAA
TGTCGTTGTTCTTGATTTTGCATCACTGTATCCATCAATTATTAGGAATTGGAACATAAGTTACGAAACTGTTGATGTAG
AAAATTGTAAGAACAAAGAATATGTAAGAGATGAAACTGGTGAAGTTTTACATTATATATGTAAAGATAAGCCGGGTATA
ACGGCTGTAATTACAGGTTTGTTGAGAGATTTTAGAGTTAAAGTTTACAAGAAAAAGGCAAAGTCACAAAATATATCTGA
AGAGCAGAGATCGGTTTATGATGTAGTGCAAAGAGCAATGAAAGTATTCATAAACGCAACTTATGGTGTATTTGGTGCTG
AGAATTTCCCACTATATGCTCCTGCTGTTGCTGAAAGTGTTACTGCAATAGGTAGATATGTTATTACTACAACGGTAAAC
TATTGTAGGTCAATTGGTTTACAAGTTTTATATGGCGATACTGATTCAATGTTTTTATGGAATCCATCTAAAGAGAAATT
AGAAGAAATAATAAAATTTGTAAAGGGTAAATTCGGTTTAGACTTAGAAGTAGATAAAATATATAAATTTGTAGCATTTT
CTGGTCTAAAGAAGAACTATTTAGGTGTTTATCCTGATGGAAAAACAGATATTAAAGGTATGTTAGCCAAGAAGAGAAAT
ACTCCGGAGTTCATTAAAAAAGAGTTTAACGAAGTTAAGCAGCTTGTCACTACTATAAATTCCCCAGATGATATACCTAA
GATAAGAGATCAATTGGAGTATAAGATTAAGGAGATATACGAGAAATTAAGACATAAGGGTTACAATCTTGATGAGCTGG
CATTTAGAGTAATGTTATCTAAGCCTTTAGAAAGTTATACTAAGAATACACCACAACATGTTAAAGCTGCATTACAATTA
AGATCTTATGGTGTAATGGTTCTACCTAGAGATATAATAATGTTTGTTAAAGTGAAAAGCAAAGATGGTGTAAAACCTGT
TCAACTTGCAAAACTGAGTGAGATAGATGTGGATAAATATATTGATGCAGTAAGATCAACATTTGAACAAATACTAAAAG
CGTTTGGTATTAATTGGGGACAATTTACTACAACTTCTATCGATACTTTCTTTAACATAAGTAAAAAGTAG

Upstream 100 bases:

>100_bases
TCCGGAGACCCGTGCTTTGTCCTGGCTAAGCTACGGGCCCTCATTAAATGGCATTTAAGTTTATATCGTATTTCAGAATA
ATAATATTTTGTAGTGAGAA

Downstream 100 bases:

>100_bases
TTTTATTCTTCTTCTTCAGCTTCTTCTGTTTCTGTCTCTTGTACTGGTGAAGTTACTTGTTTTGCGTATTCTAATAATTC
GTTTTCACTTTTATCATCTA

Product: DNA polymerase I

Products: NA

Alternate protein names: DNA polymerase B1; DNA polymerase I [H]

Number of amino acids: Translated: 876; Mature: 875

Protein sequence:

>876_residues
MARQITLFDFTLKKEQNKDESRKEEIPHANINEERRKPKEWIKEAEEGKSYFLLQVDYDGKKSKAVCKLYDKETKKIYIL
YDNTGHKPYFLTDIDPEKVNKIPKVVRDPSFDHLETVIKIDPYSGNKIKLTKIVVKDPLAVRRMRNSVPKAYEAHIKYFN
NYIYDLGLIPGLPYVVKKGKLEQVRPELKGEEVDEIRKAFADSDEMTKEAVNDWIPIFESEVPDVKRVAIDIEVYTPIKG
RIPDPEKAEFPIISISLAGNDGTKRVLVLLREDVNSQITKHDVIVETFKSERELIRRFFDIILDYPIILTFNGDDFDIPY
IYYRALKLNFTPEEIPFDIINDEGKYLAGIHIDLYKFFFNRAIRNYAFEGKYNEYNLDAVATALLGMSKVKLDTLISFLD
LDKLIEYNSRDAEITLKLTTFNNNLVWKLIILLARISKMGLEELTRTEVSTWIKNLYYWEHRRRNWLIPLKEEILTRSSQ
IKTAAIIKGKRYKGAVVIDPPAGVFFNVVVLDFASLYPSIIRNWNISYETVDVENCKNKEYVRDETGEVLHYICKDKPGI
TAVITGLLRDFRVKVYKKKAKSQNISEEQRSVYDVVQRAMKVFINATYGVFGAENFPLYAPAVAESVTAIGRYVITTTVN
YCRSIGLQVLYGDTDSMFLWNPSKEKLEEIIKFVKGKFGLDLEVDKIYKFVAFSGLKKNYLGVYPDGKTDIKGMLAKKRN
TPEFIKKEFNEVKQLVTTINSPDDIPKIRDQLEYKIKEIYEKLRHKGYNLDELAFRVMLSKPLESYTKNTPQHVKAALQL
RSYGVMVLPRDIIMFVKVKSKDGVKPVQLAKLSEIDVDKYIDAVRSTFEQILKAFGINWGQFTTTSIDTFFNISKK

Sequences:

>Translated_876_residues
MARQITLFDFTLKKEQNKDESRKEEIPHANINEERRKPKEWIKEAEEGKSYFLLQVDYDGKKSKAVCKLYDKETKKIYIL
YDNTGHKPYFLTDIDPEKVNKIPKVVRDPSFDHLETVIKIDPYSGNKIKLTKIVVKDPLAVRRMRNSVPKAYEAHIKYFN
NYIYDLGLIPGLPYVVKKGKLEQVRPELKGEEVDEIRKAFADSDEMTKEAVNDWIPIFESEVPDVKRVAIDIEVYTPIKG
RIPDPEKAEFPIISISLAGNDGTKRVLVLLREDVNSQITKHDVIVETFKSERELIRRFFDIILDYPIILTFNGDDFDIPY
IYYRALKLNFTPEEIPFDIINDEGKYLAGIHIDLYKFFFNRAIRNYAFEGKYNEYNLDAVATALLGMSKVKLDTLISFLD
LDKLIEYNSRDAEITLKLTTFNNNLVWKLIILLARISKMGLEELTRTEVSTWIKNLYYWEHRRRNWLIPLKEEILTRSSQ
IKTAAIIKGKRYKGAVVIDPPAGVFFNVVVLDFASLYPSIIRNWNISYETVDVENCKNKEYVRDETGEVLHYICKDKPGI
TAVITGLLRDFRVKVYKKKAKSQNISEEQRSVYDVVQRAMKVFINATYGVFGAENFPLYAPAVAESVTAIGRYVITTTVN
YCRSIGLQVLYGDTDSMFLWNPSKEKLEEIIKFVKGKFGLDLEVDKIYKFVAFSGLKKNYLGVYPDGKTDIKGMLAKKRN
TPEFIKKEFNEVKQLVTTINSPDDIPKIRDQLEYKIKEIYEKLRHKGYNLDELAFRVMLSKPLESYTKNTPQHVKAALQL
RSYGVMVLPRDIIMFVKVKSKDGVKPVQLAKLSEIDVDKYIDAVRSTFEQILKAFGINWGQFTTTSIDTFFNISKK
>Mature_875_residues
ARQITLFDFTLKKEQNKDESRKEEIPHANINEERRKPKEWIKEAEEGKSYFLLQVDYDGKKSKAVCKLYDKETKKIYILY
DNTGHKPYFLTDIDPEKVNKIPKVVRDPSFDHLETVIKIDPYSGNKIKLTKIVVKDPLAVRRMRNSVPKAYEAHIKYFNN
YIYDLGLIPGLPYVVKKGKLEQVRPELKGEEVDEIRKAFADSDEMTKEAVNDWIPIFESEVPDVKRVAIDIEVYTPIKGR
IPDPEKAEFPIISISLAGNDGTKRVLVLLREDVNSQITKHDVIVETFKSERELIRRFFDIILDYPIILTFNGDDFDIPYI
YYRALKLNFTPEEIPFDIINDEGKYLAGIHIDLYKFFFNRAIRNYAFEGKYNEYNLDAVATALLGMSKVKLDTLISFLDL
DKLIEYNSRDAEITLKLTTFNNNLVWKLIILLARISKMGLEELTRTEVSTWIKNLYYWEHRRRNWLIPLKEEILTRSSQI
KTAAIIKGKRYKGAVVIDPPAGVFFNVVVLDFASLYPSIIRNWNISYETVDVENCKNKEYVRDETGEVLHYICKDKPGIT
AVITGLLRDFRVKVYKKKAKSQNISEEQRSVYDVVQRAMKVFINATYGVFGAENFPLYAPAVAESVTAIGRYVITTTVNY
CRSIGLQVLYGDTDSMFLWNPSKEKLEEIIKFVKGKFGLDLEVDKIYKFVAFSGLKKNYLGVYPDGKTDIKGMLAKKRNT
PEFIKKEFNEVKQLVTTINSPDDIPKIRDQLEYKIKEIYEKLRHKGYNLDELAFRVMLSKPLESYTKNTPQHVKAALQLR
SYGVMVLPRDIIMFVKVKSKDGVKPVQLAKLSEIDVDKYIDAVRSTFEQILKAFGINWGQFTTTSIDTFFNISKK

Specific function: Thought To Be Involved In DNA Repair And/Or Mutagenesis. [C]

COG id: COG0417

COG function: function code L; DNA polymerase elongation subunit (family B)

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the DNA polymerase type-B family [H]

Homologues:

Organism=Homo sapiens, GI106507301, Length=488, Percent_Identity=26.0245901639344, Blast_Score=99, Evalue=1e-20,
Organism=Homo sapiens, GI156616275, Length=563, Percent_Identity=25.9325044404973, Blast_Score=99, Evalue=1e-20,
Organism=Escherichia coli, GI1786246, Length=704, Percent_Identity=23.1534090909091, Blast_Score=108, Evalue=2e-24,
Organism=Caenorhabditis elegans, GI17559488, Length=499, Percent_Identity=26.4529058116232, Blast_Score=94, Evalue=3e-19,
Organism=Caenorhabditis elegans, GI32565317, Length=342, Percent_Identity=28.6549707602339, Blast_Score=89, Evalue=1e-17,
Organism=Saccharomyces cerevisiae, GI6320101, Length=856, Percent_Identity=24.7663551401869, Blast_Score=115, Evalue=3e-26,
Organism=Saccharomyces cerevisiae, GI6324227, Length=385, Percent_Identity=28.3116883116883, Blast_Score=102, Evalue=3e-22,
Organism=Drosophila melanogaster, GI24648780, Length=283, Percent_Identity=27.9151943462898, Blast_Score=93, Evalue=7e-19,
Organism=Drosophila melanogaster, GI24664937, Length=529, Percent_Identity=26.0869565217391, Blast_Score=93, Evalue=8e-19,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR006172
- InterPro:   IPR017964
- InterPro:   IPR006133
- InterPro:   IPR006134
- InterPro:   IPR023211
- InterPro:   IPR012337 [H]

Pfam domain/function: PF00136 DNA_pol_B; PF03104 DNA_pol_B_exo [H]

EC number: =2.7.7.7 [H]

Molecular weight: Translated: 101586; Mature: 101455

Theoretical pI: Translated: 9.37; Mature: 9.37

Prosite motif: PS00079 MULTICOPPER_OXIDASE1 ; PS00116 DNA_POLYMERASE_B

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.5 %Cys     (Translated Protein)
1.3 %Met     (Translated Protein)
1.7 %Cys+Met (Translated Protein)
0.5 %Cys     (Mature Protein)
1.1 %Met     (Mature Protein)
1.6 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MARQITLFDFTLKKEQNKDESRKEEIPHANINEERRKPKEWIKEAEEGKSYFLLQVDYDG
CCCEEEEEEEEECCCCCCCHHHHHHCCCCCCCHHHCCHHHHHHHHHCCCEEEEEEEECCC
KKSKAVCKLYDKETKKIYILYDNTGHKPYFLTDIDPEKVNKIPKVVRDPSFDHLETVIKI
CCCCHHHHEECCCCCEEEEEEECCCCCCEEEECCCHHHHHHHHHHHCCCCHHHEEEEEEE
DPYSGNKIKLTKIVVKDPLAVRRMRNSVPKAYEAHIKYFNNYIYDLGLIPGLPYVVKKGK
CCCCCCEEEEEEEEECCCHHHHHHHHCCCHHHHHHHHHHHHHHHHHHCCCCCHHHHCCCC
LEQVRPELKGEEVDEIRKAFADSDEMTKEAVNDWIPIFESEVPDVKRVAIDIEVYTPIKG
HHHHCCCCCCCHHHHHHHHHCCCHHHHHHHHHHCCCHHCCCCCCCEEEEEEEEEECCCCC
RIPDPEKAEFPIISISLAGNDGTKRVLVLLREDVNSQITKHDVIVETFKSERELIRRFFD
CCCCCCCCCCCEEEEEEECCCCCHHHHHEEHHHHCCHHHHHHHHHHHHHHHHHHHHHHHH
IILDYPIILTFNGDDFDIPYIYYRALKLNFTPEEIPFDIINDEGKYLAGIHIDLYKFFFN
HHHCCCEEEEECCCCCCCCEEEEEEEEECCCHHHCCCEEECCCCCEEEEEHHHHHHHHHH
RAIRNYAFEGKYNEYNLDAVATALLGMSKVKLDTLISFLDLDKLIEYNSRDAEITLKLTT
HHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCEEEEEEEE
FNNNLVWKLIILLARISKMGLEELTRTEVSTWIKNLYYWEHRRRNWLIPLKEEILTRSSQ
ECCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCHHHHHCCHHC
IKTAAIIKGKRYKGAVVIDPPAGVFFNVVVLDFASLYPSIIRNWNISYETVDVENCKNKE
CCEEEEEECCCCCCEEEECCCCCHHHHHHHHHHHHHHHHHHHCCCCCEEEEECCCCCCCC
YVRDETGEVLHYICKDKPGITAVITGLLRDFRVKVYKKKAKSQNISEEQRSVYDVVQRAM
HHHCCHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHH
KVFINATYGVFGAENFPLYAPAVAESVTAIGRYVITTTVNYCRSIGLQVLYGDTDSMFLW
HHHHHHHHCCCCCCCCCEECHHHHHHHHHHHHHHHHHHHHHHHHCCCEEEECCCCCEEEE
NPSKEKLEEIIKFVKGKFGLDLEVDKIYKFVAFSGLKKNYLGVYPDGKTDIKGMLAKKRN
CCCHHHHHHHHHHHCCCCCCCEEHHHHHHHHHHHCCCCCCCEECCCCCHHHHHHHHHCCC
TPEFIKKEFNEVKQLVTTINSPDDIPKIRDQLEYKIKEIYEKLRHKGYNLDELAFRVMLS
CHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHH
KPLESYTKNTPQHVKAALQLRSYGVMVLPRDIIMFVKVKSKDGVKPVQLAKLSEIDVDKY
HHHHHHHCCCHHHHHHHHHHHHCCEEEECCEEEEEEEECCCCCCCCHHHHHHHHCCHHHH
IDAVRSTFEQILKAFGINWGQFTTTSIDTFFNISKK
HHHHHHHHHHHHHHHCCCCCCEEECCHHHHEECCCC
>Mature Secondary Structure 
ARQITLFDFTLKKEQNKDESRKEEIPHANINEERRKPKEWIKEAEEGKSYFLLQVDYDG
CCEEEEEEEEECCCCCCCHHHHHHCCCCCCCHHHCCHHHHHHHHHCCCEEEEEEEECCC
KKSKAVCKLYDKETKKIYILYDNTGHKPYFLTDIDPEKVNKIPKVVRDPSFDHLETVIKI
CCCCHHHHEECCCCCEEEEEEECCCCCCEEEECCCHHHHHHHHHHHCCCCHHHEEEEEEE
DPYSGNKIKLTKIVVKDPLAVRRMRNSVPKAYEAHIKYFNNYIYDLGLIPGLPYVVKKGK
CCCCCCEEEEEEEEECCCHHHHHHHHCCCHHHHHHHHHHHHHHHHHHCCCCCHHHHCCCC
LEQVRPELKGEEVDEIRKAFADSDEMTKEAVNDWIPIFESEVPDVKRVAIDIEVYTPIKG
HHHHCCCCCCCHHHHHHHHHCCCHHHHHHHHHHCCCHHCCCCCCCEEEEEEEEEECCCCC
RIPDPEKAEFPIISISLAGNDGTKRVLVLLREDVNSQITKHDVIVETFKSERELIRRFFD
CCCCCCCCCCCEEEEEEECCCCCHHHHHEEHHHHCCHHHHHHHHHHHHHHHHHHHHHHHH
IILDYPIILTFNGDDFDIPYIYYRALKLNFTPEEIPFDIINDEGKYLAGIHIDLYKFFFN
HHHCCCEEEEECCCCCCCCEEEEEEEEECCCHHHCCCEEECCCCCEEEEEHHHHHHHHHH
RAIRNYAFEGKYNEYNLDAVATALLGMSKVKLDTLISFLDLDKLIEYNSRDAEITLKLTT
HHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCEEEEEEEE
FNNNLVWKLIILLARISKMGLEELTRTEVSTWIKNLYYWEHRRRNWLIPLKEEILTRSSQ
ECCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCHHHHHCCHHC
IKTAAIIKGKRYKGAVVIDPPAGVFFNVVVLDFASLYPSIIRNWNISYETVDVENCKNKE
CCEEEEEECCCCCCEEEECCCCCHHHHHHHHHHHHHHHHHHHCCCCCEEEEECCCCCCCC
YVRDETGEVLHYICKDKPGITAVITGLLRDFRVKVYKKKAKSQNISEEQRSVYDVVQRAM
HHHCCHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHH
KVFINATYGVFGAENFPLYAPAVAESVTAIGRYVITTTVNYCRSIGLQVLYGDTDSMFLW
HHHHHHHHCCCCCCCCCEECHHHHHHHHHHHHHHHHHHHHHHHHCCCEEEECCCCCEEEE
NPSKEKLEEIIKFVKGKFGLDLEVDKIYKFVAFSGLKKNYLGVYPDGKTDIKGMLAKKRN
CCCHHHHHHHHHHHCCCCCCCEEHHHHHHHHHHHCCCCCCCEECCCCCHHHHHHHHHCCC
TPEFIKKEFNEVKQLVTTINSPDDIPKIRDQLEYKIKEIYEKLRHKGYNLDELAFRVMLS
CHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHH
KPLESYTKNTPQHVKAALQLRSYGVMVLPRDIIMFVKVKSKDGVKPVQLAKLSEIDVDKY
HHHHHHHCCCHHHHHHHHHHHHCCEEEECCEEEEEEEECCCCCCCCHHHHHHHHCCHHHH
IDAVRSTFEQILKAFGINWGQFTTTSIDTFFNISKK
HHHHHHHHHHHHHHHCCCCCCEEECCHHHHEECCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 10997874 [H]