| Definition | Mycobacterium abscessus ATCC 19977 chromosome chromosome 1, complete sequence. |
|---|---|
| Accession | NC_010397 |
| Length | 5,067,172 |
Click here to switch to the map view.
The map label for this gene is polA [H]
Identifier: 169629701
GI number: 169629701
Start: 2655155
End: 2657863
Strand: Reverse
Name: polA [H]
Synonym: MAB_2615c
Alternate gene names: 169629701
Gene position: 2657863-2655155 (Counterclockwise)
Preceding gene: 169629702
Following gene: 169629692
Centisome position: 52.45
GC content: 64.05
Gene sequence:
>2709_bases GTGACTGCGCCTGCGACGAAGACCGGAACCAAACAGCCGACCCTCCTGCTGCTCGACGGTAACTCGCTGGCGTTCCGCGC GTTCTACGCGCTTCCGGCCGAGAATTTCAAGACGCAGTCGGGCTTGACCACCAACGCGGTATACGGGTTCACCTCGATGT TGATCAATCTGCTGCGCGATGAGGCGCCCACACACGTGGCGGCCGCCTTCGATGTCTCCCGCAAGACGTTCCGGTCCGAC CGGTACCCCGAGTACAAGGCCACTCGGTCGGCCACCCCCGACGAGTTCCGCGGACAGATCGACATCACCAAGGAAGTACT CCAGGCCCTGGGCATCACGGTGCTGGCAGAGGAGGGGTTCGAGGCCGACGACATCATCGCCACCCTGGCCACCCAGGGGC AGGCCGAGGGTTTCAAGGTGTTCGTGGTCACGGGCGATCGCGACTCGCTGCAGCTCGTCAACGAGGACGTGACGGTGCTC TACCCGCGCAAGGGTGTCAGCGATCTCACCCGATTCACCCCGGAAGCGGTAGTCGAGAAGTACGGACTCACGCCCTCCCA GTACCCGGACTTCGCGGCGCTGCGCGGTGACCCGAGCGACAACCTGCCGGGAATTCCTGGAGTTGGGGAGAAGACCGCGT CCAAGTGGATCCTCGAGTACGGATCGCTCCAAGAGCTGGTTGACAAGGCCGATACCGTGCGCGGAAAGGTGGGGGATTCG CTGCGCGCCAACCTCGCCTCGGTGATCCTGAACCGCGAACTGACCGATCTGGTGCGGACGGTGCCGCTGCCCTATGTGCC CGCCCAGTTGGCGCTGGCGCCGTGGGATCGGGACCAGATTCACCGGCTGTTCGACGACCTCGAGTTCCGGGTCCTGCGTG ACCGGCTGTTCGAAACCCTGGAAGCGGTCGAACCCGAGGTGGACGAGGGCTTCCAGCTGGCCGGCCAGGCGCTGGAACCC GGCACGGTCGCCGCGTGGCTGGCCGAACACACCGGGGATGGCCGCCGTAGCGGTTTGGCGGTGGTCGGGACCTATACGCC CTATGACGGCGACGCTACCGCGGTGGCGATCGCGTCCGCCGATGGCGACGGCGCCTATATAGACACCACGACGGTGACTC CGGACGATGAGGCGGCACTTGCCGAGTGGCTGGCCGATGCGGCCCGTCCCAAGGCATTGCATGAGGCGAAGCAGGCCATA CACGCTTTGGCCGGCCGCGGGTGGGAGCTCGGCGGAGTGACCTCCGATACCGCGCTGGCTGCGTATCTGGTGCGCCCGGG GCAGCGCAGCTTCGCACTCGACGACTTGTCGTTGCGGTATCTGCGTCGCGAACTTCGCGCTGAAGATGATGGAGAACAAC AGCTCTCACTACTGGACGAGGATGGCGCGGGCGATGCGAAGGCAGCTCAAGCCCAGATGTTGCGTGCCCGTGCGGTGATC GATCTGGCCGACGCGCTCGATGTCGAGCTCGAACGCATCGAATCGGCAGGGCTGCTCACCGACATGGAGCTGCCGGTTCA GCGGGTGCTGGCCGGTCTGGAATCCGTCGGTATCGCGGTCGACACCGATCATCTGTCTTCGCTGCAGAATCAGTTCGCCA GCGGCATCCGTGAGGCTGCGGATGCCGCGTACGCCGTCATCGGTAAGCAGATCAACCTGGGCTCACCCAAGCAGCTGCAG GTGGTGCTGTTCGACGAGTTGGGTATGCCCAAGACCAAGAAGACAAAGACCGGTTACACCACCGACGCGGACGCCCTACA GACGCTGTTCGATAAGACCGGGCATCCGTTTCTGGAGCATCTGCTCACGCACCGTGATGTCACCAGGCTGAAGGTGACTG TCGACGGCTTGCTCAAATCTGTTGCGGCCGACGGGCGTATTCACACCACGTTCAACCAGACCATCGCGGCGACTGGTCGG CTGTCCTCGACCGAACCGAACTTGCAGAACATCCCGGTACGTACCGAGGCCGGGCGGGAGATCCGCGACGGATTCGTGGT CGGCGCGGGCTACCGCGAGCTGATGACCGTCGACTACAGCCAGATCGAGATGCGCATCATGGCGCACCTGTCGGCCGACG AGGGCCTCATCGAGGCGTTCAACACCGGTGAGGATTTACACTCGTTCGTGGCCGCCCGTGCCTTCGGTGTGCCCATCGAC GAGGTCACCGCGGAGTTGCGCCGGCGGGTCAAGGCAATGTCCTACGGCCTGGCGTATGGTCTGTCGGCCTATGGACTGGC CACACAGCTCAAGATCTCCAATGATGAGGCCAAAGAGCAGATGGACCAATATTTCTCGCGGTTTGGCGGGGTGCGCGACT ATCTGCGTGCAGTTGTCGATCAGGCCCGCAAGGATGGATACACCTCGACCGTGCTGGGGCGCCGTCGATACCTGCCCGAT TTGGACAGTGGCGATCGCCTCCGCCGCGAGGCCGCAGAACGCGCGGCTCTGAACGCTCCAATCCAGGGGAGCGCCGCCGA CATCATCAAGGTTGCGATGATCACCACGGATAAGGCATTGAGGGACAAGGGCTTACGGTCACGAATGCTCCTGCAGGTGC ACGATGAGCTCCTCTTCGAGGTTGCCGAGGGCGAACGCGAGAGCCTCGAGGCATTGGTACGCAAGACCATGGGCTCGGCG TATCCACTCGATGTGCCGCTCGAGGTTTCCGTGGGGTACGGCCGCAGCTGGGATGCCGCCGCACACTGA
Upstream 100 bases:
>100_bases ATCCCTCGGGCCACTACCTGGAGATCCTCACCCGGCCCTACGGGTCAGGGGAAGCGTCGGGGTCGTAGGTCCTGTCGCAC CCGTTGCCTAGGGTAGGAGT
Downstream 100 bases:
>100_bases TATTGCGCGCTAGTGCACGTCGGGCGTGTGTACCCGCTCGGGACGCAGCCCCCTGCCGACGGCGATCGGCGGTATGAATT TGAGCGGCCACCGCCCCACG
Product: DNA polymerase I
Products: NA
Alternate protein names: POL I [H]
Number of amino acids: Translated: 902; Mature: 901
Protein sequence:
>902_residues MTAPATKTGTKQPTLLLLDGNSLAFRAFYALPAENFKTQSGLTTNAVYGFTSMLINLLRDEAPTHVAAAFDVSRKTFRSD RYPEYKATRSATPDEFRGQIDITKEVLQALGITVLAEEGFEADDIIATLATQGQAEGFKVFVVTGDRDSLQLVNEDVTVL YPRKGVSDLTRFTPEAVVEKYGLTPSQYPDFAALRGDPSDNLPGIPGVGEKTASKWILEYGSLQELVDKADTVRGKVGDS LRANLASVILNRELTDLVRTVPLPYVPAQLALAPWDRDQIHRLFDDLEFRVLRDRLFETLEAVEPEVDEGFQLAGQALEP GTVAAWLAEHTGDGRRSGLAVVGTYTPYDGDATAVAIASADGDGAYIDTTTVTPDDEAALAEWLADAARPKALHEAKQAI HALAGRGWELGGVTSDTALAAYLVRPGQRSFALDDLSLRYLRRELRAEDDGEQQLSLLDEDGAGDAKAAQAQMLRARAVI DLADALDVELERIESAGLLTDMELPVQRVLAGLESVGIAVDTDHLSSLQNQFASGIREAADAAYAVIGKQINLGSPKQLQ VVLFDELGMPKTKKTKTGYTTDADALQTLFDKTGHPFLEHLLTHRDVTRLKVTVDGLLKSVAADGRIHTTFNQTIAATGR LSSTEPNLQNIPVRTEAGREIRDGFVVGAGYRELMTVDYSQIEMRIMAHLSADEGLIEAFNTGEDLHSFVAARAFGVPID EVTAELRRRVKAMSYGLAYGLSAYGLATQLKISNDEAKEQMDQYFSRFGGVRDYLRAVVDQARKDGYTSTVLGRRRYLPD LDSGDRLRREAAERAALNAPIQGSAADIIKVAMITTDKALRDKGLRSRMLLQVHDELLFEVAEGERESLEALVRKTMGSA YPLDVPLEVSVGYGRSWDAAAH
Sequences:
>Translated_902_residues MTAPATKTGTKQPTLLLLDGNSLAFRAFYALPAENFKTQSGLTTNAVYGFTSMLINLLRDEAPTHVAAAFDVSRKTFRSD RYPEYKATRSATPDEFRGQIDITKEVLQALGITVLAEEGFEADDIIATLATQGQAEGFKVFVVTGDRDSLQLVNEDVTVL YPRKGVSDLTRFTPEAVVEKYGLTPSQYPDFAALRGDPSDNLPGIPGVGEKTASKWILEYGSLQELVDKADTVRGKVGDS LRANLASVILNRELTDLVRTVPLPYVPAQLALAPWDRDQIHRLFDDLEFRVLRDRLFETLEAVEPEVDEGFQLAGQALEP GTVAAWLAEHTGDGRRSGLAVVGTYTPYDGDATAVAIASADGDGAYIDTTTVTPDDEAALAEWLADAARPKALHEAKQAI HALAGRGWELGGVTSDTALAAYLVRPGQRSFALDDLSLRYLRRELRAEDDGEQQLSLLDEDGAGDAKAAQAQMLRARAVI DLADALDVELERIESAGLLTDMELPVQRVLAGLESVGIAVDTDHLSSLQNQFASGIREAADAAYAVIGKQINLGSPKQLQ VVLFDELGMPKTKKTKTGYTTDADALQTLFDKTGHPFLEHLLTHRDVTRLKVTVDGLLKSVAADGRIHTTFNQTIAATGR LSSTEPNLQNIPVRTEAGREIRDGFVVGAGYRELMTVDYSQIEMRIMAHLSADEGLIEAFNTGEDLHSFVAARAFGVPID EVTAELRRRVKAMSYGLAYGLSAYGLATQLKISNDEAKEQMDQYFSRFGGVRDYLRAVVDQARKDGYTSTVLGRRRYLPD LDSGDRLRREAAERAALNAPIQGSAADIIKVAMITTDKALRDKGLRSRMLLQVHDELLFEVAEGERESLEALVRKTMGSA YPLDVPLEVSVGYGRSWDAAAH >Mature_901_residues TAPATKTGTKQPTLLLLDGNSLAFRAFYALPAENFKTQSGLTTNAVYGFTSMLINLLRDEAPTHVAAAFDVSRKTFRSDR YPEYKATRSATPDEFRGQIDITKEVLQALGITVLAEEGFEADDIIATLATQGQAEGFKVFVVTGDRDSLQLVNEDVTVLY PRKGVSDLTRFTPEAVVEKYGLTPSQYPDFAALRGDPSDNLPGIPGVGEKTASKWILEYGSLQELVDKADTVRGKVGDSL RANLASVILNRELTDLVRTVPLPYVPAQLALAPWDRDQIHRLFDDLEFRVLRDRLFETLEAVEPEVDEGFQLAGQALEPG TVAAWLAEHTGDGRRSGLAVVGTYTPYDGDATAVAIASADGDGAYIDTTTVTPDDEAALAEWLADAARPKALHEAKQAIH ALAGRGWELGGVTSDTALAAYLVRPGQRSFALDDLSLRYLRRELRAEDDGEQQLSLLDEDGAGDAKAAQAQMLRARAVID LADALDVELERIESAGLLTDMELPVQRVLAGLESVGIAVDTDHLSSLQNQFASGIREAADAAYAVIGKQINLGSPKQLQV VLFDELGMPKTKKTKTGYTTDADALQTLFDKTGHPFLEHLLTHRDVTRLKVTVDGLLKSVAADGRIHTTFNQTIAATGRL SSTEPNLQNIPVRTEAGREIRDGFVVGAGYRELMTVDYSQIEMRIMAHLSADEGLIEAFNTGEDLHSFVAARAFGVPIDE VTAELRRRVKAMSYGLAYGLSAYGLATQLKISNDEAKEQMDQYFSRFGGVRDYLRAVVDQARKDGYTSTVLGRRRYLPDL DSGDRLRREAAERAALNAPIQGSAADIIKVAMITTDKALRDKGLRSRMLLQVHDELLFEVAEGERESLEALVRKTMGSAY PLDVPLEVSVGYGRSWDAAAH
Specific function: In addition to polymerase activity, this DNA polymerase exhibits 3' to 5' and 5' to 3' exonuclease activity [H]
COG id: COG0749
COG function: function code L; DNA polymerase I - 3'-5' exonuclease and polymerase domains
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 1 5'-3' exonuclease domain [H]
Homologues:
Organism=Homo sapiens, GI112420958, Length=523, Percent_Identity=31.1663479923518, Blast_Score=227, Evalue=4e-59, Organism=Homo sapiens, GI139394648, Length=616, Percent_Identity=27.2727272727273, Blast_Score=203, Evalue=7e-52, Organism=Escherichia coli, GI1790294, Length=510, Percent_Identity=40.7843137254902, Blast_Score=338, Evalue=8e-94, Organism=Escherichia coli, GI226510970, Length=208, Percent_Identity=28.8461538461538, Blast_Score=99, Evalue=1e-21, Organism=Caenorhabditis elegans, GI86563272, Length=422, Percent_Identity=28.6729857819905, Blast_Score=166, Evalue=4e-41, Organism=Drosophila melanogaster, GI17933644, Length=449, Percent_Identity=33.630289532294, Blast_Score=224, Evalue=2e-58,
Paralogues:
None
Copy number: 400 Molecules/Cell In: Glucose minimal media [C]
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR002562 - InterPro: IPR020046 - InterPro: IPR020045 - InterPro: IPR002421 - InterPro: IPR020047 - InterPro: IPR019760 - InterPro: IPR001098 - InterPro: IPR018320 - InterPro: IPR002298 - InterPro: IPR008918 - InterPro: IPR003583 - InterPro: IPR012337 [H]
Pfam domain/function: PF01367 5_3_exonuc; PF02739 5_3_exonuc_N; PF00476 DNA_pol_A [H]
EC number: =2.7.7.7 [H]
Molecular weight: Translated: 98327; Mature: 98196
Theoretical pI: Translated: 4.66; Mature: 4.66
Prosite motif: PS00447 DNA_POLYMERASE_A
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.0 %Cys (Translated Protein) 1.4 %Met (Translated Protein) 1.4 %Cys+Met (Translated Protein) 0.0 %Cys (Mature Protein) 1.3 %Met (Mature Protein) 1.3 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MTAPATKTGTKQPTLLLLDGNSLAFRAFYALPAENFKTQSGLTTNAVYGFTSMLINLLRD CCCCCCCCCCCCCEEEEEECCCEEEEEEEECCCCCCCCCCCCCHHHHHHHHHHHHHHHHC EAPTHVAAAFDVSRKTFRSDRYPEYKATRSATPDEFRGQIDITKEVLQALGITVLAEEGF CCCCHHHHHHHHHHHHHHCCCCCCCCCCCCCCCHHHCCCCHHHHHHHHHCCEEEEECCCC EADDIIATLATQGQAEGFKVFVVTGDRDSLQLVNEDVTVLYPRKGVSDLTRFTPEAVVEK CHHHHHHHHHCCCCCCCEEEEEEECCCCCHHEECCCEEEEECCCCHHHHHHCCHHHHHHH YGLTPSQYPDFAALRGDPSDNLPGIPGVGEKTASKWILEYGSLQELVDKADTVRGKVGDS HCCCCCCCCCCEEECCCCCCCCCCCCCCCCHHHHHHHHHHCCHHHHHHHHHHHHHHCCCH LRANLASVILNRELTDLVRTVPLPYVPAQLALAPWDRDQIHRLFDDLEFRVLRDRLFETL HHHHHHHHHHHHHHHHHHHHCCCCCCCHHHEECCCCHHHHHHHHHHHHHHHHHHHHHHHH EAVEPEVDEGFQLAGQALEPGTVAAWLAEHTGDGRRSGLAVVGTYTPYDGDATAVAIASA HHHCCCCCCCHHHHCCCCCCCHHHHHHHHHCCCCCCCCEEEEEECCCCCCCCCEEEEEEC DGDGAYIDTTTVTPDDEAALAEWLADAARPKALHEAKQAIHALAGRGWELGGVTSDTALA CCCCCEEECCCCCCCHHHHHHHHHHHHCCCHHHHHHHHHHHHHHCCCEECCCCCCHHHHH AYLVRPGQRSFALDDLSLRYLRRELRAEDDGEQQLSLLDEDGAGDAKAAQAQMLRARAVI HHHCCCCCCCEEHHHHHHHHHHHHHCCCCCCHHHHHHHCCCCCCCHHHHHHHHHHHHHHH DLADALDVELERIESAGLLTDMELPVQRVLAGLESVGIAVDTDHLSSLQNQFASGIREAA HHHHHHHHHHHHHHHCCCEECCCCCHHHHHHHHHHCCEEEEHHHHHHHHHHHHHHHHHHH DAAYAVIGKQINLGSPKQLQVVLFDELGMPKTKKTKTGYTTDADALQTLFDKTGHPFLEH HHHHHHHCCCCCCCCCCEEEEEEEECCCCCCCCCCCCCCCCCHHHHHHHHHCCCCHHHHH LLTHRDVTRLKVTVDGLLKSVAADGRIHTTFNQTIAATGRLSSTEPNLQNIPVRTEAGRE HHHHCCHHEEEEEHHHHHHHHHCCCEEEEECCCHHHCCCCCCCCCCCCCCCCCCCCCCCH IRDGFVVGAGYRELMTVDYSQIEMRIMAHLSADEGLIEAFNTGEDLHSFVAARAFGVPID HHCCEEECCCHHHHHHCCHHHHHHHHHHHCCCCCHHHHHHCCCHHHHHHHHHHHCCCCHH EVTAELRRRVKAMSYGLAYGLSAYGLATQLKISNDEAKEQMDQYFSRFGGVRDYLRAVVD HHHHHHHHHHHHHHHHHHHHHHHHCCEEEEEECCHHHHHHHHHHHHHHCCHHHHHHHHHH QARKDGYTSTVLGRRRYLPDLDSGDRLRREAAERAALNAPIQGSAADIIKVAMITTDKAL HHHHCCCHHHHHHHHHCCCCCCCCHHHHHHHHHHHHCCCCCCCCHHHHHEEHHHCCCHHH RDKGLRSRMLLQVHDELLFEVAEGERESLEALVRKTMGSAYPLDVPLEVSVGYGRSWDAA HHCCHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHCCCCCCCCCCEEEEECCCCCCCCC AH CC >Mature Secondary Structure TAPATKTGTKQPTLLLLDGNSLAFRAFYALPAENFKTQSGLTTNAVYGFTSMLINLLRD CCCCCCCCCCCCEEEEEECCCEEEEEEEECCCCCCCCCCCCCHHHHHHHHHHHHHHHHC EAPTHVAAAFDVSRKTFRSDRYPEYKATRSATPDEFRGQIDITKEVLQALGITVLAEEGF CCCCHHHHHHHHHHHHHHCCCCCCCCCCCCCCCHHHCCCCHHHHHHHHHCCEEEEECCCC EADDIIATLATQGQAEGFKVFVVTGDRDSLQLVNEDVTVLYPRKGVSDLTRFTPEAVVEK CHHHHHHHHHCCCCCCCEEEEEEECCCCCHHEECCCEEEEECCCCHHHHHHCCHHHHHHH YGLTPSQYPDFAALRGDPSDNLPGIPGVGEKTASKWILEYGSLQELVDKADTVRGKVGDS HCCCCCCCCCCEEECCCCCCCCCCCCCCCCHHHHHHHHHHCCHHHHHHHHHHHHHHCCCH LRANLASVILNRELTDLVRTVPLPYVPAQLALAPWDRDQIHRLFDDLEFRVLRDRLFETL HHHHHHHHHHHHHHHHHHHHCCCCCCCHHHEECCCCHHHHHHHHHHHHHHHHHHHHHHHH EAVEPEVDEGFQLAGQALEPGTVAAWLAEHTGDGRRSGLAVVGTYTPYDGDATAVAIASA HHHCCCCCCCHHHHCCCCCCCHHHHHHHHHCCCCCCCCEEEEEECCCCCCCCCEEEEEEC DGDGAYIDTTTVTPDDEAALAEWLADAARPKALHEAKQAIHALAGRGWELGGVTSDTALA CCCCCEEECCCCCCCHHHHHHHHHHHHCCCHHHHHHHHHHHHHHCCCEECCCCCCHHHHH AYLVRPGQRSFALDDLSLRYLRRELRAEDDGEQQLSLLDEDGAGDAKAAQAQMLRARAVI HHHCCCCCCCEEHHHHHHHHHHHHHCCCCCCHHHHHHHCCCCCCCHHHHHHHHHHHHHHH DLADALDVELERIESAGLLTDMELPVQRVLAGLESVGIAVDTDHLSSLQNQFASGIREAA HHHHHHHHHHHHHHHCCCEECCCCCHHHHHHHHHHCCEEEEHHHHHHHHHHHHHHHHHHH DAAYAVIGKQINLGSPKQLQVVLFDELGMPKTKKTKTGYTTDADALQTLFDKTGHPFLEH HHHHHHHCCCCCCCCCCEEEEEEEECCCCCCCCCCCCCCCCCHHHHHHHHHCCCCHHHHH LLTHRDVTRLKVTVDGLLKSVAADGRIHTTFNQTIAATGRLSSTEPNLQNIPVRTEAGRE HHHHCCHHEEEEEHHHHHHHHHCCCEEEEECCCHHHCCCCCCCCCCCCCCCCCCCCCCCH IRDGFVVGAGYRELMTVDYSQIEMRIMAHLSADEGLIEAFNTGEDLHSFVAARAFGVPID HHCCEEECCCHHHHHHCCHHHHHHHHHHHCCCCCHHHHHHCCCHHHHHHHHHHHCCCCHH EVTAELRRRVKAMSYGLAYGLSAYGLATQLKISNDEAKEQMDQYFSRFGGVRDYLRAVVD HHHHHHHHHHHHHHHHHHHHHHHHCCEEEEEECCHHHHHHHHHHHHHHCCHHHHHHHHHH QARKDGYTSTVLGRRRYLPDLDSGDRLRREAAERAALNAPIQGSAADIIKVAMITTDKAL HHHHCCCHHHHHHHHHCCCCCCCCHHHHHHHHHHHHCCCCCCCCHHHHHEEHHHCCCHHH RDKGLRSRMLLQVHDELLFEVAEGERESLEALVRKTMGSAYPLDVPLEVSVGYGRSWDAA HHCCHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHCCCCCCCCCCEEEEECCCCCCCCC AH CC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 12788972 [H]