| Definition | Corynebacterium diphtheriae NCTC 13129 chromosome, complete genome. |
|---|---|
| Accession | NC_002935 |
| Length | 2,488,635 |
Click here to switch to the map view.
The map label for this gene is polA [H]
Identifier: 38233736
GI number: 38233736
Start: 1129828
End: 1132527
Strand: Direct
Name: polA [H]
Synonym: DIP1146
Alternate gene names: 38233736
Gene position: 1129828-1132527 (Clockwise)
Preceding gene: 38233731
Following gene: 38233738
Centisome position: 45.4
GC content: 49.15
Gene sequence:
>2700_bases ATGTTAGATGTACTCGTTACACTGGCCATCGTGACTTCCAATGCGAACCGACTCATGCTTATCGACGGCCACTCGATGGC CTTCCGTGCGTTCTACGCGCTGCCTGCGGAGAACTTCTCTACATCGGGCGGACAGGCGACGAATGCCGTTTACGGATTTT TGTCGATGTTGTCGTCTCTGCTCGTTGAAGAAAAGCCAACCCACGTAGCAGTTGCGTTCGACGTTGGCCGCCAAACATTT CGAACCGAGATGTTCCCTGAATACAAAGCGCAGCGTGAGGCTGCGCCACCAGAATTCAAGGGACAGGTGGAAATTATTAA AGAGGTCCTAGAGACTTTGGGAATCACCACCTTGGAAAAAGAAAATTTTGAGGCGGACGATATCATCGCCACGTTGGCTA CCGCAGCGGGTCCACTTGGTTTTGATACGTATATCGTTACTGGTGATCGCGATTCTTTCCAGCTAGTAAACGAATCAACC ACGGTGCTGTATCCCATGCGTGGTGTATCTGTTCTTCATCGTTTCACCCCAGAAGCGGTGGAAGAAAAATATGGATTAAC TCCAGTACAGTATCCAGATTTCGCGGCATTGCGGGGAGATCCTTCAGATAATTTGCCTAATATCCCAGGTGTTGGTGAGA AAACCGCTACAAAGTGGATCGTCCAATATGGAAATCTGGATTCCTTGCTTGCTCATGCCGATGAGATTAAGGGCAAAGCT GGTAATAGCTTCCGAGAGCGTTTAGATCAGGTGCGTATGAATCGCACTTTGACTGAGATGATCAAGGATCTCGAACTTCC TTATGCTCCAGATCAGCTCGAGCGCAAACCCGCTGATGCGTCGGCAATTGCATCTAAGTTTGATGAACTTGAATTTGGAT CGAATCTCCGCGATCGAGTAATCCATGCAGTTGATGCGCAAGGGAACGTCTCTGAAGAGTCTGAAGAATACAAGCCTGAA GTCGTCATCGACCATGAAAAACTAGCATCATGGCTTGCCACTCGTGCTGGGCAGTCACTGGCATTGTATGTGCGAGGCCA TGGTAGTCCCGCCAGTGGTGATGCTGAGTCGGCGGCGATCGTCGATAAGCAATTCCATGCTGTAGCGTTTGATTTCGGTG ACCTTGACGCCGATGACGACCAAGCATTTGCGCAGTGGATTGCTAGTGATTCGCCTAAATACCTACATGAAGCTAAAGCT GTATTTCATATGCTCGCAGGCAGGGGCTACACTCTCAACGGCATCGAGCATGATACCGCAATTGCGGGGTACTTATTGCG CCCTGGCCAGCGCACGTATGATCTGAAAGACGTGTATCAGCGCCATTTGCAACGTCAACTAGGCGGCGGTTCTAGCGAGA GCGGTCAACTATCGTTGCTTGACGCACCTGATGCTCAAGAACTTGTTGACAGTGCTGTAGCGATTTTGGAGTTAAGTAAA TCGCTTACTGCGCAACTACAAGCTATCGACGCATATGAGCTCTATCGGGAAATGGAGCTTCCGCTCGTTGGCGTGTTGGC GCGCATGGAGGCAACTGGAATTTGCGTTGATGTGGCCACATTGCGGGAACAGCGAGACATATTTGTTGAGCAGGTTAAAG AAGAAGAAAGCGCTGCCCGGGAACTCGCGGGGGACGAGACTCTAAATCTGTCGAGCCCAAAGCAGCTTCAAGTAGTTTTA TTTGACACATTAGGGCTTCCTAAGACTAAGAAGACCAAGACTGGATACTCCACGGCAGCAAAAGAAATAGAATCGCTGGC TGTTAAAAATCCACATCCGTTCCTTGATCATCTCTTGGCGCATCGAGAGTTCCAAAAGATGAAAACCACTCTAGACGGCC TCATTAAAGCAGTCGGAGATGACGGTCGTATTCACACTACGTTTAATCAAACTGTCGCCTCAACTGGTCGTTTGAGTTCA ACGGAACCAAACCTGCAAAACATTCCTGTGCGTACTCCAGCAGGAAGGAAAATTCGCTCTGCTTTTGTGGTAGGACAAGG GTATAAGTCTCTGCTGACGGCAGACTATTCGCAGATTGAGATGCGTGTGATGGCGCATCTTTCTGAGGATCCAGGTTTGA TTGAGGCTTATCAAACGGGTGAGGACCTCCACAATTTTGTGGGTTCGAAGGTCTTCGATGTGCCAGTTGATCAAGTAACT CCTGAACTACGTCGCCGAGTTAAAGCGATGAGCTATGGGTTGGTCTATGGGCTTTCTGCATTTGGTCTTTCCCAACAATT AAACATCCCTGCTGGTGAAGCCAAAGTGATCATGGAAAGCTACTTCGAACGATTCGGAGGGGTAAAACGATATCTTGACC AAGTGGTCGAACAAGCCCGAAAGGATGGGTTCACATCGACTTTGTTTGGCCGTCGACGTTACTTGCCGGAGCTTTCTTCG GATAATCGAGTGGCACGTGAAAATGCCGAACGAGCTGCATTGAATGCTCCAATTCAAGGCACAGCAGCAGACATTATTAA GATTGCAATGCTGCGTGTCGACGCCCGCCTTACTGCAGAAAACTGCCAATCGAGGGTGCTTCTTCAAGTCCACGACGAAT TGGTGCTCGAGGTAGCTTCAGGTGAACAAGAAAAGGTTCAACAACTTGTAGAAGAAGAAATGGACGCCGCTATTTCACTG CGCGTACCGCTGGAGGTTTCTGCAGGTGTCGGTACAAACTGGGAAGAAGCTGCGCATTAA
Upstream 100 bases:
>100_bases GTTTCCTCTGCCAATTGGGATACAGGGGCGCTGGAAAAAACTATAGACCATTAAGGTGGGTTTATGCCAAATTGCCTGTT CGGAGGGTGGATTCGGGCAA
Downstream 100 bases:
>100_bases TTTCAAGCTGGAATTGAGCCCGTGGCTGAGTGCGGAATTCATTCACGGGCTAACGGCAATGCGTTACAAAAATAGCTGTT CCTGGAAAGATACGACCTCT
Product: DNA polymerase I
Products: NA
Alternate protein names: POL I [H]
Number of amino acids: Translated: 899; Mature: 899
Protein sequence:
>899_residues MLDVLVTLAIVTSNANRLMLIDGHSMAFRAFYALPAENFSTSGGQATNAVYGFLSMLSSLLVEEKPTHVAVAFDVGRQTF RTEMFPEYKAQREAAPPEFKGQVEIIKEVLETLGITTLEKENFEADDIIATLATAAGPLGFDTYIVTGDRDSFQLVNEST TVLYPMRGVSVLHRFTPEAVEEKYGLTPVQYPDFAALRGDPSDNLPNIPGVGEKTATKWIVQYGNLDSLLAHADEIKGKA GNSFRERLDQVRMNRTLTEMIKDLELPYAPDQLERKPADASAIASKFDELEFGSNLRDRVIHAVDAQGNVSEESEEYKPE VVIDHEKLASWLATRAGQSLALYVRGHGSPASGDAESAAIVDKQFHAVAFDFGDLDADDDQAFAQWIASDSPKYLHEAKA VFHMLAGRGYTLNGIEHDTAIAGYLLRPGQRTYDLKDVYQRHLQRQLGGGSSESGQLSLLDAPDAQELVDSAVAILELSK SLTAQLQAIDAYELYREMELPLVGVLARMEATGICVDVATLREQRDIFVEQVKEEESAARELAGDETLNLSSPKQLQVVL FDTLGLPKTKKTKTGYSTAAKEIESLAVKNPHPFLDHLLAHREFQKMKTTLDGLIKAVGDDGRIHTTFNQTVASTGRLSS TEPNLQNIPVRTPAGRKIRSAFVVGQGYKSLLTADYSQIEMRVMAHLSEDPGLIEAYQTGEDLHNFVGSKVFDVPVDQVT PELRRRVKAMSYGLVYGLSAFGLSQQLNIPAGEAKVIMESYFERFGGVKRYLDQVVEQARKDGFTSTLFGRRRYLPELSS DNRVARENAERAALNAPIQGTAADIIKIAMLRVDARLTAENCQSRVLLQVHDELVLEVASGEQEKVQQLVEEEMDAAISL RVPLEVSAGVGTNWEEAAH
Sequences:
>Translated_899_residues MLDVLVTLAIVTSNANRLMLIDGHSMAFRAFYALPAENFSTSGGQATNAVYGFLSMLSSLLVEEKPTHVAVAFDVGRQTF RTEMFPEYKAQREAAPPEFKGQVEIIKEVLETLGITTLEKENFEADDIIATLATAAGPLGFDTYIVTGDRDSFQLVNEST TVLYPMRGVSVLHRFTPEAVEEKYGLTPVQYPDFAALRGDPSDNLPNIPGVGEKTATKWIVQYGNLDSLLAHADEIKGKA GNSFRERLDQVRMNRTLTEMIKDLELPYAPDQLERKPADASAIASKFDELEFGSNLRDRVIHAVDAQGNVSEESEEYKPE VVIDHEKLASWLATRAGQSLALYVRGHGSPASGDAESAAIVDKQFHAVAFDFGDLDADDDQAFAQWIASDSPKYLHEAKA VFHMLAGRGYTLNGIEHDTAIAGYLLRPGQRTYDLKDVYQRHLQRQLGGGSSESGQLSLLDAPDAQELVDSAVAILELSK SLTAQLQAIDAYELYREMELPLVGVLARMEATGICVDVATLREQRDIFVEQVKEEESAARELAGDETLNLSSPKQLQVVL FDTLGLPKTKKTKTGYSTAAKEIESLAVKNPHPFLDHLLAHREFQKMKTTLDGLIKAVGDDGRIHTTFNQTVASTGRLSS TEPNLQNIPVRTPAGRKIRSAFVVGQGYKSLLTADYSQIEMRVMAHLSEDPGLIEAYQTGEDLHNFVGSKVFDVPVDQVT PELRRRVKAMSYGLVYGLSAFGLSQQLNIPAGEAKVIMESYFERFGGVKRYLDQVVEQARKDGFTSTLFGRRRYLPELSS DNRVARENAERAALNAPIQGTAADIIKIAMLRVDARLTAENCQSRVLLQVHDELVLEVASGEQEKVQQLVEEEMDAAISL RVPLEVSAGVGTNWEEAAH >Mature_899_residues MLDVLVTLAIVTSNANRLMLIDGHSMAFRAFYALPAENFSTSGGQATNAVYGFLSMLSSLLVEEKPTHVAVAFDVGRQTF RTEMFPEYKAQREAAPPEFKGQVEIIKEVLETLGITTLEKENFEADDIIATLATAAGPLGFDTYIVTGDRDSFQLVNEST TVLYPMRGVSVLHRFTPEAVEEKYGLTPVQYPDFAALRGDPSDNLPNIPGVGEKTATKWIVQYGNLDSLLAHADEIKGKA GNSFRERLDQVRMNRTLTEMIKDLELPYAPDQLERKPADASAIASKFDELEFGSNLRDRVIHAVDAQGNVSEESEEYKPE VVIDHEKLASWLATRAGQSLALYVRGHGSPASGDAESAAIVDKQFHAVAFDFGDLDADDDQAFAQWIASDSPKYLHEAKA VFHMLAGRGYTLNGIEHDTAIAGYLLRPGQRTYDLKDVYQRHLQRQLGGGSSESGQLSLLDAPDAQELVDSAVAILELSK SLTAQLQAIDAYELYREMELPLVGVLARMEATGICVDVATLREQRDIFVEQVKEEESAARELAGDETLNLSSPKQLQVVL FDTLGLPKTKKTKTGYSTAAKEIESLAVKNPHPFLDHLLAHREFQKMKTTLDGLIKAVGDDGRIHTTFNQTVASTGRLSS TEPNLQNIPVRTPAGRKIRSAFVVGQGYKSLLTADYSQIEMRVMAHLSEDPGLIEAYQTGEDLHNFVGSKVFDVPVDQVT PELRRRVKAMSYGLVYGLSAFGLSQQLNIPAGEAKVIMESYFERFGGVKRYLDQVVEQARKDGFTSTLFGRRRYLPELSS DNRVARENAERAALNAPIQGTAADIIKIAMLRVDARLTAENCQSRVLLQVHDELVLEVASGEQEKVQQLVEEEMDAAISL RVPLEVSAGVGTNWEEAAH
Specific function: In addition to polymerase activity, this DNA polymerase exhibits 3' to 5' and 5' to 3' exonuclease activity [H]
COG id: COG0749
COG function: function code L; DNA polymerase I - 3'-5' exonuclease and polymerase domains
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 1 5'-3' exonuclease domain [H]
Homologues:
Organism=Homo sapiens, GI112420958, Length=509, Percent_Identity=31.041257367387, Blast_Score=233, Evalue=5e-61, Organism=Homo sapiens, GI139394648, Length=617, Percent_Identity=26.904376012966, Blast_Score=198, Evalue=2e-50, Organism=Escherichia coli, GI1790294, Length=939, Percent_Identity=37.1671991480298, Blast_Score=524, Evalue=1e-149, Organism=Escherichia coli, GI226510970, Length=224, Percent_Identity=24.5535714285714, Blast_Score=92, Evalue=2e-19, Organism=Caenorhabditis elegans, GI86563272, Length=355, Percent_Identity=32.112676056338, Blast_Score=158, Evalue=9e-39, Organism=Drosophila melanogaster, GI17933644, Length=532, Percent_Identity=29.3233082706767, Blast_Score=204, Evalue=2e-52,
Paralogues:
None
Copy number: 400 Molecules/Cell In: Glucose minimal media [C]
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR002562 - InterPro: IPR020046 - InterPro: IPR020045 - InterPro: IPR002421 - InterPro: IPR020047 - InterPro: IPR019760 - InterPro: IPR001098 - InterPro: IPR018320 - InterPro: IPR002298 - InterPro: IPR008918 - InterPro: IPR012337 [H]
Pfam domain/function: PF01367 5_3_exonuc; PF02739 5_3_exonuc_N; PF00476 DNA_pol_A [H]
EC number: =2.7.7.7 [H]
Molecular weight: Translated: 99020; Mature: 99020
Theoretical pI: Translated: 4.74; Mature: 4.74
Prosite motif: PS00447 DNA_POLYMERASE_A
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.2 %Cys (Translated Protein) 2.0 %Met (Translated Protein) 2.2 %Cys+Met (Translated Protein) 0.2 %Cys (Mature Protein) 2.0 %Met (Mature Protein) 2.2 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MLDVLVTLAIVTSNANRLMLIDGHSMAFRAFYALPAENFSTSGGQATNAVYGFLSMLSSL CHHHHEEEHHEECCCCEEEEEECCCHHHHHHHCCCCCCCCCCCCCHHHHHHHHHHHHHHH LVEEKPTHVAVAFDVGRQTFRTEMFPEYKAQREAAPPEFKGQVEIIKEVLETLGITTLEK HHCCCCCEEEEEEECCHHHHHHHHCHHHHHHHCCCCCCCCCHHHHHHHHHHHHCCEEECC ENFEADDIIATLATAAGPLGFDTYIVTGDRDSFQLVNESTTVLYPMRGVSVLHRFTPEAV CCCCHHHHHHHHHHHCCCCCCCEEEEECCCCCCEEECCCCEEEEECHHHHHHHHCCHHHH EEKYGLTPVQYPDFAALRGDPSDNLPNIPGVGEKTATKWIVQYGNLDSLLAHADEIKGKA HHHCCCCCCCCCCCCEECCCCCCCCCCCCCCCCHHHHHHHHHCCCHHHHHHHHHHHCCCC GNSFRERLDQVRMNRTLTEMIKDLELPYAPDQLERKPADASAIASKFDELEFGSNLRDRV CCHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHCCCCCHHHHHHHHHHHHCCCCHHHHH IHAVDAQGNVSEESEEYKPEVVIDHEKLASWLATRAGQSLALYVRGHGSPASGDAESAAI HHHCCCCCCCCCCHHHCCCCEEECHHHHHHHHHHHCCCEEEEEEEECCCCCCCCCCHHHH VDKQFHAVAFDFGDLDADDDQAFAQWIASDSPKYLHEAKAVFHMLAGRGYTLNGIEHDTA HHHHHHEEEEECCCCCCCCHHHHHHHHHCCCHHHHHHHHHHHHHHHCCCCEECCCCCHHH IAGYLLRPGQRTYDLKDVYQRHLQRQLGGGSSESGQLSLLDAPDAQELVDSAVAILELSK HHHHHCCCCCCCCCHHHHHHHHHHHHHCCCCCCCCCEEEECCCCHHHHHHHHHHHHHHHH SLTAQLQAIDAYELYREMELPLVGVLARMEATGICVDVATLREQRDIFVEQVKEEESAAR HHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHCCEEEEHHHHHHHHHHHHHHHHHHHHHHH ELAGDETLNLSSPKQLQVVLFDTLGLPKTKKTKTGYSTAAKEIESLAVKNPHPFLDHLLA HHCCCCCCCCCCCCEEEEEEEECCCCCCCCCCCCCHHHHHHHHHHHHCCCCCHHHHHHHH HREFQKMKTTLDGLIKAVGDDGRIHTTFNQTVASTGRLSSTEPNLQNIPVRTPAGRKIRS HHHHHHHHHHHHHHHHHHCCCCCEEEEHHHHHHCCCCCCCCCCCCCCCCCCCCCCCHHHH AFVVGQGYKSLLTADYSQIEMRVMAHLSEDPGLIEAYQTGEDLHNFVGSKVFDVPVDQVT HHEECCCHHHHHHHHHHHHHHHHHHHCCCCCCCEEHHHCHHHHHHHHCCEEEECCHHHCC PELRRRVKAMSYGLVYGLSAFGLSQQLNIPAGEAKVIMESYFERFGGVKRYLDQVVEQAR HHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHCHHHHHHHHHHHHHH KDGFTSTLFGRRRYLPELSSDNRVARENAERAALNAPIQGTAADIIKIAMLRVDARLTAE HCCCHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHH NCQSRVLLQVHDELVLEVASGEQEKVQQLVEEEMDAAISLRVPLEVSAGVGTNWEEAAH HHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHCCEEEEEECEEECCCCCCCHHHHCC >Mature Secondary Structure MLDVLVTLAIVTSNANRLMLIDGHSMAFRAFYALPAENFSTSGGQATNAVYGFLSMLSSL CHHHHEEEHHEECCCCEEEEEECCCHHHHHHHCCCCCCCCCCCCCHHHHHHHHHHHHHHH LVEEKPTHVAVAFDVGRQTFRTEMFPEYKAQREAAPPEFKGQVEIIKEVLETLGITTLEK HHCCCCCEEEEEEECCHHHHHHHHCHHHHHHHCCCCCCCCCHHHHHHHHHHHHCCEEECC ENFEADDIIATLATAAGPLGFDTYIVTGDRDSFQLVNESTTVLYPMRGVSVLHRFTPEAV CCCCHHHHHHHHHHHCCCCCCCEEEEECCCCCCEEECCCCEEEEECHHHHHHHHCCHHHH EEKYGLTPVQYPDFAALRGDPSDNLPNIPGVGEKTATKWIVQYGNLDSLLAHADEIKGKA HHHCCCCCCCCCCCCEECCCCCCCCCCCCCCCCHHHHHHHHHCCCHHHHHHHHHHHCCCC GNSFRERLDQVRMNRTLTEMIKDLELPYAPDQLERKPADASAIASKFDELEFGSNLRDRV CCHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHCCCCCHHHHHHHHHHHHCCCCHHHHH IHAVDAQGNVSEESEEYKPEVVIDHEKLASWLATRAGQSLALYVRGHGSPASGDAESAAI HHHCCCCCCCCCCHHHCCCCEEECHHHHHHHHHHHCCCEEEEEEEECCCCCCCCCCHHHH VDKQFHAVAFDFGDLDADDDQAFAQWIASDSPKYLHEAKAVFHMLAGRGYTLNGIEHDTA HHHHHHEEEEECCCCCCCCHHHHHHHHHCCCHHHHHHHHHHHHHHHCCCCEECCCCCHHH IAGYLLRPGQRTYDLKDVYQRHLQRQLGGGSSESGQLSLLDAPDAQELVDSAVAILELSK HHHHHCCCCCCCCCHHHHHHHHHHHHHCCCCCCCCCEEEECCCCHHHHHHHHHHHHHHHH SLTAQLQAIDAYELYREMELPLVGVLARMEATGICVDVATLREQRDIFVEQVKEEESAAR HHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHCCEEEEHHHHHHHHHHHHHHHHHHHHHHH ELAGDETLNLSSPKQLQVVLFDTLGLPKTKKTKTGYSTAAKEIESLAVKNPHPFLDHLLA HHCCCCCCCCCCCCEEEEEEEECCCCCCCCCCCCCHHHHHHHHHHHHCCCCCHHHHHHHH HREFQKMKTTLDGLIKAVGDDGRIHTTFNQTVASTGRLSSTEPNLQNIPVRTPAGRKIRS HHHHHHHHHHHHHHHHHHCCCCCEEEEHHHHHHCCCCCCCCCCCCCCCCCCCCCCCHHHH AFVVGQGYKSLLTADYSQIEMRVMAHLSEDPGLIEAYQTGEDLHNFVGSKVFDVPVDQVT HHEECCCHHHHHHHHHHHHHHHHHHHCCCCCCCEEHHHCHHHHHHHHCCEEEECCHHHCC PELRRRVKAMSYGLVYGLSAFGLSQQLNIPAGEAKVIMESYFERFGGVKRYLDQVVEQAR HHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHCHHHHHHHHHHHHHH KDGFTSTLFGRRRYLPELSSDNRVARENAERAALNAPIQGTAADIIKIAMLRVDARLTAE HCCCHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHH NCQSRVLLQVHDELVLEVASGEQEKVQQLVEEEMDAAISLRVPLEVSAGVGTNWEEAAH HHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHCCEEEEEECEEECCCCCCCHHHHCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 7476188; 11234002 [H]