Definition Bacillus cereus subsp. cytotoxis NVH 391-98, complete genome.
Accession NC_009674
Length 4,087,024

Click here to switch to the map view.

The map label for this gene is polA [H]

Identifier: 152976969

GI number: 152976969

Start: 3338003

End: 3340636

Strand: Reverse

Name: polA [H]

Synonym: Bcer98_3272

Alternate gene names: 152976969

Gene position: 3340636-3338003 (Counterclockwise)

Preceding gene: 152976970

Following gene: 152976968

Centisome position: 81.74

GC content: 37.51

Gene sequence:

>2634_bases
TTGGAAAAAAAAGTTGTATTAGTTGATGGAAATAATATCGCATATCGTGCTTTTTTCGCACTACCGCTTTTAAATAACGA
TAAGGGGATACATACGAACGCAATTTATGGTTTTACAATGATGCTTATGAGGATATTGGAAGAAGAAAAGCCTACGCATA
TGCTTGTGGCATTTGATGCTGGGAAGACAACATTCCGCCATAAGACATTTAGTGACTATAAGGGGGGACGTCAAAAAACG
CCACCTGAACTTTCAGAGCAATTCCCCTTCATTCGCGAATTGTTAGATGCTTTTCGTGTACCTCGTTATGAATTAGAAGA
CTACGAGGCTGATGATATTATGGGGACGTTAGCGAAAGAAGCAAGTGAACAAGGGGCACAGGTAAAAGTAATTTCCGGAG
ATAAAGATTTACTTCAACTCGTTTCTGATCATACACGTGTATGTATTCCGCGTAAAGGAATTACAGAAGTGGACGAGTAT
ACAAAAGAGGCACTCTTTGAAAAGTATAACTTATCACCAAAACAAATTATTGATATGAAAGGGCTAATGGGGGACCAATC
GGATAACATTCCTGGCGTTCCAGGTGTTGGAGAGAAAACGGCGATTAAACTGTTAACGCAATTTGGGACAGTGGAAGCTG
TATATGAAAATCTAGATCAAGTGAGCGGTAAGAAGTTAAAAGAAAAATTAGAGACACATAAAGAGCAAGCATTTATGAGT
AAAGAACTTGCGACAATTATTACGGATGCACCTATTACTGTGCATATAGATGATATTGAATATAAAGGATATGAGGCAGG
CGACATTATTCCTCTTTTTGAAAATCTAGGTTTTACGTCTTTATTAAATAAGCTTGGGGCTCCTTCTGAAGAAGCTGTTT
CAGCTGAATTAGATGATATTTCATTTGAAATTGCTGAAGAAGTAACAGAAGAGATGCTGCAGCAAGATAGTGCAATCATT
GTAGAAGTGCAAGAAGAGAATTATCATAAAGCAGACATTCAAGGATTTGGTATTCAAAATGACAATGGCTGTTATTTCAT
CCCAACGGATATAGCTCTTGCGTCTGAGGCGTTCATAAAATGGCTGAAGGATGAAGAAATGAGAAAGTATACATTTGATG
CTAAACGTGCCATTGTAGCACTTAAATGGAAAGGCGTAGAAATTAGAGGGGTTGATTTTGATTTATTAATCGCTGCGTAT
TTACTTGACCCAGCTGATACAGACAAAGATTTCCGTACGGTAGCAAAAATGAAAGAAACACATGCGGTGAAATCGGATGA
AGAAGTGTATGGTAAGGGAGCAAAACGTGCTGTTCCGGCGCAGGAAATTGTTGCAGAACACGTAGCGCGCAAAGTACATG
TCTTATATGATGTAAAACAAACATTTATAGATGAATTAGAGAAAAATGAACAATATGAACTGTTCATAAACCTTGAAATG
CCGCTAGCGTGCGTCTTAGCTGACATGGAAGTAAAAGGTGTGAAAGTTGATACAGAGCGCTTGCGTAATATGGGAGATGA
ACTTGCTGGTAGACTAAAGGAAATGGAGCAAGAAATTTATGAGCTTGCTGGTACAGAATTTAATATTAATTCGCCAAAGC
AGCTCGGTGTTGTTCTATTTGAGAAGCTGAATTTACCAGTGATTAAAAAGACGAAGACAGGATATTCTACATCAGCTGAT
GTACTAGATAAGTTGATGGATCATCATGAAATTATTCCAAAGATTTTACATTATCGTCAACTTGGCAAATTGAACTCAAC
GTATATTGAAGGTCTACTAAAAGTTGTTCATGATGAGTCATCTAAAATTCATACTCGTTTTAATCAAGTATTAACACAAA
CGGGGCGCTTAAGTTCTACAGAACCGAATTTACAAAATATCCCGATTCGTTTAGAGGAGGGAAGAAAGATTCGCCAGGCT
TTTATTCCTTCACAAGAAGGATGGGTTATGTATGCGGCTGATTATTCACAAATCGAATTACGTGTACTGGCACATATTGC
AAAAGATAAAGGATTAATAGAAGCATTTCAGCATGATATGGATATTCATACAAAGACAGCAATGGATGTCTTTGGTGTTG
AAAAAGATGAAGTAACAGCAAATATGAGACGACAAGCAAAAGCAGTAAACTTTGGGATTGTGTACGGCATTAGCGATTAC
GGACTTTCACAAAACTTAGGAATTACACGAAAAGCAGCAGGAGAATTTATCGAGAAGTATTTTGCTAGCTTCCCTGGTGT
AAAAGAGTATATGGATGAAATTGTCCAAGAAGCGAAACAAAAGGGATATGTTTCTACTTTATTAAATCGTCGTCGTTATA
TTCCAGAAATTACAAGTCGGAATTTTAATGTGCGTAGTTTTGCTGAGCGTACAGCAATGAATACACCAATTCAAGGCAGT
GCCGCTGATATTATTAAAAAAGCAATGATCGTTATGGCAGATCGTTTAGAAGAAGAAGGACTACAAGCGCGTCTTCTTTT
ACAAGTACACGATGAATTAATCTTTGAAGTGCCAAAAGAGGAAATAGAAAAACTTGAAAAGCTTGTCCCAGAAGTAATGG
AACATGCGATTGAACTTGCTGTTCCGCTAAAGGTTGATTATTCATACGGGCCAACTTGGTATGATGCAAAATAA

Upstream 100 bases:

>100_bases
TTTTCTTCTCTCTCTTAGTCGTGTTAATATAGAGAGAAGGAAAGAACGGTTTTTTTATATGGGAAAGAACAGTTCAATTT
TGTATGGGGAGGTTTCAAAT

Downstream 100 bases:

>100_bases
GGAAGTGATAAAATGCCCGAATTACCAGAAGTTGAAAATGTAAGAAGAACACTTGAAAATCTTGTAACAGGAAAAACAAT
GAAAGATGTAATTGTAACAT

Product: DNA polymerase I

Products: NA

Alternate protein names: POL I [H]

Number of amino acids: Translated: 877; Mature: 877

Protein sequence:

>877_residues
MEKKVVLVDGNNIAYRAFFALPLLNNDKGIHTNAIYGFTMMLMRILEEEKPTHMLVAFDAGKTTFRHKTFSDYKGGRQKT
PPELSEQFPFIRELLDAFRVPRYELEDYEADDIMGTLAKEASEQGAQVKVISGDKDLLQLVSDHTRVCIPRKGITEVDEY
TKEALFEKYNLSPKQIIDMKGLMGDQSDNIPGVPGVGEKTAIKLLTQFGTVEAVYENLDQVSGKKLKEKLETHKEQAFMS
KELATIITDAPITVHIDDIEYKGYEAGDIIPLFENLGFTSLLNKLGAPSEEAVSAELDDISFEIAEEVTEEMLQQDSAII
VEVQEENYHKADIQGFGIQNDNGCYFIPTDIALASEAFIKWLKDEEMRKYTFDAKRAIVALKWKGVEIRGVDFDLLIAAY
LLDPADTDKDFRTVAKMKETHAVKSDEEVYGKGAKRAVPAQEIVAEHVARKVHVLYDVKQTFIDELEKNEQYELFINLEM
PLACVLADMEVKGVKVDTERLRNMGDELAGRLKEMEQEIYELAGTEFNINSPKQLGVVLFEKLNLPVIKKTKTGYSTSAD
VLDKLMDHHEIIPKILHYRQLGKLNSTYIEGLLKVVHDESSKIHTRFNQVLTQTGRLSSTEPNLQNIPIRLEEGRKIRQA
FIPSQEGWVMYAADYSQIELRVLAHIAKDKGLIEAFQHDMDIHTKTAMDVFGVEKDEVTANMRRQAKAVNFGIVYGISDY
GLSQNLGITRKAAGEFIEKYFASFPGVKEYMDEIVQEAKQKGYVSTLLNRRRYIPEITSRNFNVRSFAERTAMNTPIQGS
AADIIKKAMIVMADRLEEEGLQARLLLQVHDELIFEVPKEEIEKLEKLVPEVMEHAIELAVPLKVDYSYGPTWYDAK

Sequences:

>Translated_877_residues
MEKKVVLVDGNNIAYRAFFALPLLNNDKGIHTNAIYGFTMMLMRILEEEKPTHMLVAFDAGKTTFRHKTFSDYKGGRQKT
PPELSEQFPFIRELLDAFRVPRYELEDYEADDIMGTLAKEASEQGAQVKVISGDKDLLQLVSDHTRVCIPRKGITEVDEY
TKEALFEKYNLSPKQIIDMKGLMGDQSDNIPGVPGVGEKTAIKLLTQFGTVEAVYENLDQVSGKKLKEKLETHKEQAFMS
KELATIITDAPITVHIDDIEYKGYEAGDIIPLFENLGFTSLLNKLGAPSEEAVSAELDDISFEIAEEVTEEMLQQDSAII
VEVQEENYHKADIQGFGIQNDNGCYFIPTDIALASEAFIKWLKDEEMRKYTFDAKRAIVALKWKGVEIRGVDFDLLIAAY
LLDPADTDKDFRTVAKMKETHAVKSDEEVYGKGAKRAVPAQEIVAEHVARKVHVLYDVKQTFIDELEKNEQYELFINLEM
PLACVLADMEVKGVKVDTERLRNMGDELAGRLKEMEQEIYELAGTEFNINSPKQLGVVLFEKLNLPVIKKTKTGYSTSAD
VLDKLMDHHEIIPKILHYRQLGKLNSTYIEGLLKVVHDESSKIHTRFNQVLTQTGRLSSTEPNLQNIPIRLEEGRKIRQA
FIPSQEGWVMYAADYSQIELRVLAHIAKDKGLIEAFQHDMDIHTKTAMDVFGVEKDEVTANMRRQAKAVNFGIVYGISDY
GLSQNLGITRKAAGEFIEKYFASFPGVKEYMDEIVQEAKQKGYVSTLLNRRRYIPEITSRNFNVRSFAERTAMNTPIQGS
AADIIKKAMIVMADRLEEEGLQARLLLQVHDELIFEVPKEEIEKLEKLVPEVMEHAIELAVPLKVDYSYGPTWYDAK
>Mature_877_residues
MEKKVVLVDGNNIAYRAFFALPLLNNDKGIHTNAIYGFTMMLMRILEEEKPTHMLVAFDAGKTTFRHKTFSDYKGGRQKT
PPELSEQFPFIRELLDAFRVPRYELEDYEADDIMGTLAKEASEQGAQVKVISGDKDLLQLVSDHTRVCIPRKGITEVDEY
TKEALFEKYNLSPKQIIDMKGLMGDQSDNIPGVPGVGEKTAIKLLTQFGTVEAVYENLDQVSGKKLKEKLETHKEQAFMS
KELATIITDAPITVHIDDIEYKGYEAGDIIPLFENLGFTSLLNKLGAPSEEAVSAELDDISFEIAEEVTEEMLQQDSAII
VEVQEENYHKADIQGFGIQNDNGCYFIPTDIALASEAFIKWLKDEEMRKYTFDAKRAIVALKWKGVEIRGVDFDLLIAAY
LLDPADTDKDFRTVAKMKETHAVKSDEEVYGKGAKRAVPAQEIVAEHVARKVHVLYDVKQTFIDELEKNEQYELFINLEM
PLACVLADMEVKGVKVDTERLRNMGDELAGRLKEMEQEIYELAGTEFNINSPKQLGVVLFEKLNLPVIKKTKTGYSTSAD
VLDKLMDHHEIIPKILHYRQLGKLNSTYIEGLLKVVHDESSKIHTRFNQVLTQTGRLSSTEPNLQNIPIRLEEGRKIRQA
FIPSQEGWVMYAADYSQIELRVLAHIAKDKGLIEAFQHDMDIHTKTAMDVFGVEKDEVTANMRRQAKAVNFGIVYGISDY
GLSQNLGITRKAAGEFIEKYFASFPGVKEYMDEIVQEAKQKGYVSTLLNRRRYIPEITSRNFNVRSFAERTAMNTPIQGS
AADIIKKAMIVMADRLEEEGLQARLLLQVHDELIFEVPKEEIEKLEKLVPEVMEHAIELAVPLKVDYSYGPTWYDAK

Specific function: In addition to polymerase activity, this DNA polymerase exhibits 3' to 5' and 5' to 3' exonuclease activity [H]

COG id: COG0749

COG function: function code L; DNA polymerase I - 3'-5' exonuclease and polymerase domains

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 5'-3' exonuclease domain [H]

Homologues:

Organism=Homo sapiens, GI112420958, Length=527, Percent_Identity=34.3453510436433, Blast_Score=265, Evalue=2e-70,
Organism=Homo sapiens, GI139394648, Length=610, Percent_Identity=27.0491803278689, Blast_Score=212, Evalue=1e-54,
Organism=Escherichia coli, GI1790294, Length=937, Percent_Identity=37.9935965848452, Blast_Score=571, Evalue=1e-164,
Organism=Escherichia coli, GI226510970, Length=223, Percent_Identity=35.4260089686099, Blast_Score=141, Evalue=2e-34,
Organism=Caenorhabditis elegans, GI86563272, Length=411, Percent_Identity=30.1703163017032, Blast_Score=185, Evalue=1e-46,
Organism=Drosophila melanogaster, GI17933644, Length=419, Percent_Identity=33.890214797136, Blast_Score=239, Evalue=4e-63,

Paralogues:

None

Copy number: 400 Molecules/Cell In: Glucose minimal media [C]

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR002562
- InterPro:   IPR020046
- InterPro:   IPR020045
- InterPro:   IPR002421
- InterPro:   IPR020047
- InterPro:   IPR019760
- InterPro:   IPR001098
- InterPro:   IPR018320
- InterPro:   IPR002298
- InterPro:   IPR008918
- InterPro:   IPR003583
- InterPro:   IPR012337 [H]

Pfam domain/function: PF01367 5_3_exonuc; PF02739 5_3_exonuc_N; PF00476 DNA_pol_A [H]

EC number: =2.7.7.7 [H]

Molecular weight: Translated: 99508; Mature: 99508

Theoretical pI: Translated: 4.87; Mature: 4.87

Prosite motif: PS00447 DNA_POLYMERASE_A

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.3 %Cys     (Translated Protein)
3.0 %Met     (Translated Protein)
3.3 %Cys+Met (Translated Protein)
0.3 %Cys     (Mature Protein)
3.0 %Met     (Mature Protein)
3.3 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MEKKVVLVDGNNIAYRAFFALPLLNNDKGIHTNAIYGFTMMLMRILEEEKPTHMLVAFDA
CCCEEEEEECCCEEEEEEEEEEEECCCCCCCCHHHHHHHHHHHHHHHCCCCCEEEEEEEC
GKTTFRHKTFSDYKGGRQKTPPELSEQFPFIRELLDAFRVPRYELEDYEADDIMGTLAKE
CCCEECCCCHHHCCCCCCCCCCCHHHCCHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHH
ASEQGAQVKVISGDKDLLQLVSDHTRVCIPRKGITEVDEYTKEALFEKYNLSPKQIIDMK
HHHCCCEEEEECCCHHHHHHHHCCCEEEECCCCCHHHHHHHHHHHHHHHCCCHHHHHHHH
GLMGDQSDNIPGVPGVGEKTAIKLLTQFGTVEAVYENLDQVSGKKLKEKLETHKEQAFMS
HCCCCCCCCCCCCCCCCHHHHHHHHHHHCHHHHHHHHHHHHCHHHHHHHHHHHHHHHHHH
KELATIITDAPITVHIDDIEYKGYEAGDIIPLFENLGFTSLLNKLGAPSEEAVSAELDDI
HHHHHHHCCCCEEEEEECCEECCCCCCCCHHHHHCCCHHHHHHHHCCCCHHHHHHHHHHH
SFEIAEEVTEEMLQQDSAIIVEVQEENYHKADIQGFGIQNDNGCYFIPTDIALASEAFIK
HHHHHHHHHHHHHHCCCEEEEEEECCCCCCCCCEECCEECCCCCEEEECHHHHHHHHHHH
WLKDEEMRKYTFDAKRAIVALKWKGVEIRGVDFDLLIAAYLLDPADTDKDFRTVAKMKET
HHHHHHHHHHHHHHHHEEEEEEECCEEEECCCHHHHHHHHHCCCCCCCHHHHHHHHHHHH
HAVKSDEEVYGKGAKRAVPAQEIVAEHVARKVHVLYDVKQTFIDELEKNEQYELFINLEM
HCCCCCHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEEEEECC
PLACVLADMEVKGVKVDTERLRNMGDELAGRLKEMEQEIYELAGTEFNINSPKQLGVVLF
CHHHHEECCCCCCEEECHHHHHCCHHHHHHHHHHHHHHHHHHCCCCCCCCCCHHHHHHHH
EKLNLPVIKKTKTGYSTSADVLDKLMDHHEIIPKILHYRQLGKLNSTYIEGLLKVVHDES
HHCCCCEEEECCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHCCC
SKIHTRFNQVLTQTGRLSSTEPNLQNIPIRLEEGRKIRQAFIPSQEGWVMYAADYSQIEL
HHHHHHHHHHHHHCCCCCCCCCCCCCCCEEECCCHHHHHHHCCCCCCEEEEECCCHHHHH
RVLAHIAKDKGLIEAFQHDMDIHTKTAMDVFGVEKDEVTANMRRQAKAVNFGIVYGISDY
HHHHHHHHCCHHHHHHHHCCCCHHHHHHHHHCCCHHHHHHHHHHHHHHCCEEEEEEECCC
GLSQNLGITRKAAGEFIEKYFASFPGVKEYMDEIVQEAKQKGYVSTLLNRRRYIPEITSR
CCCCCCCCHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHCCHHHHHHHHHHCCCHHHCC
NFNVRSFAERTAMNTPIQGSAADIIKKAMIVMADRLEEEGLQARLLLQVHDELIFEVPKE
CCCHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHCCHH
EIEKLEKLVPEVMEHAIELAVPLKVDYSYGPTWYDAK
HHHHHHHHHHHHHHHHHHEEEEEEEECCCCCEECCCC
>Mature Secondary Structure
MEKKVVLVDGNNIAYRAFFALPLLNNDKGIHTNAIYGFTMMLMRILEEEKPTHMLVAFDA
CCCEEEEEECCCEEEEEEEEEEEECCCCCCCCHHHHHHHHHHHHHHHCCCCCEEEEEEEC
GKTTFRHKTFSDYKGGRQKTPPELSEQFPFIRELLDAFRVPRYELEDYEADDIMGTLAKE
CCCEECCCCHHHCCCCCCCCCCCHHHCCHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHH
ASEQGAQVKVISGDKDLLQLVSDHTRVCIPRKGITEVDEYTKEALFEKYNLSPKQIIDMK
HHHCCCEEEEECCCHHHHHHHHCCCEEEECCCCCHHHHHHHHHHHHHHHCCCHHHHHHHH
GLMGDQSDNIPGVPGVGEKTAIKLLTQFGTVEAVYENLDQVSGKKLKEKLETHKEQAFMS
HCCCCCCCCCCCCCCCCHHHHHHHHHHHCHHHHHHHHHHHHCHHHHHHHHHHHHHHHHHH
KELATIITDAPITVHIDDIEYKGYEAGDIIPLFENLGFTSLLNKLGAPSEEAVSAELDDI
HHHHHHHCCCCEEEEEECCEECCCCCCCCHHHHHCCCHHHHHHHHCCCCHHHHHHHHHHH
SFEIAEEVTEEMLQQDSAIIVEVQEENYHKADIQGFGIQNDNGCYFIPTDIALASEAFIK
HHHHHHHHHHHHHHCCCEEEEEEECCCCCCCCCEECCEECCCCCEEEECHHHHHHHHHHH
WLKDEEMRKYTFDAKRAIVALKWKGVEIRGVDFDLLIAAYLLDPADTDKDFRTVAKMKET
HHHHHHHHHHHHHHHHEEEEEEECCEEEECCCHHHHHHHHHCCCCCCCHHHHHHHHHHHH
HAVKSDEEVYGKGAKRAVPAQEIVAEHVARKVHVLYDVKQTFIDELEKNEQYELFINLEM
HCCCCCHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEEEEECC
PLACVLADMEVKGVKVDTERLRNMGDELAGRLKEMEQEIYELAGTEFNINSPKQLGVVLF
CHHHHEECCCCCCEEECHHHHHCCHHHHHHHHHHHHHHHHHHCCCCCCCCCCHHHHHHHH
EKLNLPVIKKTKTGYSTSADVLDKLMDHHEIIPKILHYRQLGKLNSTYIEGLLKVVHDES
HHCCCCEEEECCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHCCC
SKIHTRFNQVLTQTGRLSSTEPNLQNIPIRLEEGRKIRQAFIPSQEGWVMYAADYSQIEL
HHHHHHHHHHHHHCCCCCCCCCCCCCCCEEECCCHHHHHHHCCCCCCEEEEECCCHHHHH
RVLAHIAKDKGLIEAFQHDMDIHTKTAMDVFGVEKDEVTANMRRQAKAVNFGIVYGISDY
HHHHHHHHCCHHHHHHHHCCCCHHHHHHHHHCCCHHHHHHHHHHHHHHCCEEEEEEECCC
GLSQNLGITRKAAGEFIEKYFASFPGVKEYMDEIVQEAKQKGYVSTLLNRRRYIPEITSR
CCCCCCCCHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHCCHHHHHHHHHHCCCHHHCC
NFNVRSFAERTAMNTPIQGSAADIIKKAMIVMADRLEEEGLQARLLLQVHDELIFEVPKE
CCCHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHCCHH
EIEKLEKLVPEVMEHAIELAVPLKVDYSYGPTWYDAK
HHHHHHHHHHHHHHHHHHEEEEEEEECCCCCEECCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 9387221; 9384377 [H]