Definition Thermus thermophilus HB8 chromosome, complete genome.
Accession NC_006461
Length 1,849,742

Click here to switch to the map view.

The map label for this gene is pcrA [H]

Identifier: 55981396

GI number: 55981396

Start: 1354610

End: 1356688

Strand: Reverse

Name: pcrA [H]

Synonym: TTHA1427

Alternate gene names: 55981396

Gene position: 1356688-1354610 (Counterclockwise)

Preceding gene: 55981402

Following gene: 55981395

Centisome position: 73.34

GC content: 71.24

Gene sequence:

>2079_bases
GTGAGCGACGCCCTCCTAGCCCCCCTCAACGAGGCCCAGCGCCAGGCGGTCCTCCACTTTGAGGGGCCCGCCCTGGTGGT
GGCCGGGGCGGGGAGCGGGAAGACCCGCACCGTGGTCCACCGGGTGGCCTACCTCGTCGCCCGCCGGGGGGTCTTCCCCT
CGGAGATCCTGGCCGTCACCTTCACCAACAAGGCCGCCGAGGAGATGCGGGAGCGCCTCCGGGGGCTGGTCCCGGGGGCG
GGGGAGGTCTGGGTCTCCACCTTCCACGCCGCCGCCTTGAGGATCCTCCGCGTCTACGGGGAGCGGGTGGGCCTCAGGCC
CGGCTTCGTGGTCTACGACGAGGACGACCAGACCGCCCTCCTCAAGGAGGTCCTGAAGGAGCTCGCCCTCTCGGCCCGGC
CCGGCCCCATCAAGGCCCTTTTGGACCGGGCGAAGAACCGGGGCGTGGGCCTTAAGGCCCTCCTCGGCGAGCTTCCCGAG
TACTACGCCGGGCTTTCCCGGGGAAGGCTTGGGGACGTCCTGGTGCGCTACCAGGAGGCCCTTAAGGCCCAGGGGGCCTT
GGACTTCGGGGACATCCTCCTCTACGCCCTGAGGCTTTTAGAGGAGGACGAGGAGGTCCTCAGGCTCGTGCGCAAGCGGG
CCCGCTTCATCCACGTGGACGAGTACCAGGACACGAGCCCCGTCCAGTACCGCTTCACCCGGCTTCTCGCCGGGGAGGAG
GCCAACCTCATGGCCGTGGGCGACCCCGACCAGGGGATCTACTCCTTCCGGGCGGCGGACATCAAGAACATCCTGGACTT
CACCCGGGACTACCCCGAGGCCCGGGTCTACCGCTTGGAGGAGAACTACCGCTCCACCGAGGCCATCCTCCGCTTCGCCA
ACGCCGTGATCGTGAAGAACGCCCTCCGCCTGGAGAAGGCCCTGCGCCCGGTGAAGCGGGGCGGGGAGCCCGTGCGCCTC
TACCGGGCGGAGGACGCCCGGGAGGAGGCCCGCTTCGTGGCCGAGGAGATCGCCCGGCTCGGCCCCCCCTGGGACCGGTA
CGCCGTCCTCTACCGCACCAACGCCCAAAGCCGCCTTCTGGAACAGGCGTTGGCGGGGCGGGGGATCCCGGCGCGGGTGG
TGGGCGGCGTGGGGTTCTTTGAAAGGGCCGAGGTCAAGGACCTCCTGGCCTACGCCCGCCTCGCCCTCAACCCCCTGGAC
GCCGTGAGCCTGAAGCGGGTCCTGAACACCCCCCCTCGGGGCATCGGCCCGGCCACCTGGGCCAGGGTGCAGCTCCTCGC
CCAGGAGAAGGGGCTTCCTCCCTGGGAGGCCCTGAAGGAGGCGGCCAGGACCTTTTCCCGCCCCGAGCCCCTGAGGCACT
TCGTGGCCCTGGTGGAGGAGCTTCAGGACCTGGTCTTCGGCCCCGCCGAGGCCTTCTTCCGCCACCTCCTCGAGGCCACC
GACTACCCCGCCTACCTCCGGGAGGCCTACCCCGAGGACGCCGAGGACCGCCTGGAGAACGTGGAGGAGCTCCTCAGGGC
GGCCAAGGAGGCGGAGGACCTGCAGGACTTCCTGGACCGGGTGGCCCTCACCGCCAAGGCGGAGGAGCCCGCCGAGGCGG
AGGGGAGGGTCGCCCTCATGACCCTGCACAACGCCAAGGGGCTGGAGTTCCCCGTGGTCTTCCTCGTGGGGGTGGAGGAG
GGGCTTCTGCCCCACCGCAACTCCGTGAGCACCCTCGAGGGCCTGGAGGAGGAGCGCCGCCTCTTCTACGTGGGCATCAC
CCGGGCCCAGGAGAGGCTCTACCTCTCCCACGCCGAGGAGCGGGAGGTCTACGGCAGGCGGGAGCCCGCCCGGCCGAGCC
GCTTCCTGGAGGAGGTGGAGGAGGGGCTTTACGAGGTGTACGACCCCTACCGGCGCCCGCCCTCCCCGCCCCCCCATCGC
CCGAGGCCCGGGGCCTTCCGGGGCGGGGAGCGGGTGGTCCACCCCCGCTTCGGCCCCGGCACCGTGGTGGCGGCCCAGGG
GGACGAGGTCACGGTCCACTTTGAGGGGTTTGGGCTCAAGCGCCTTTCCCTCAAGTACGCGGAGCTTAAGCCGGCATGA

Upstream 100 bases:

>100_bases
CTGGAAGGTGAAGCCCCGGGCCATCTCCCCTACGAAGCCGTCCTGCGTGGCCACAAGCTCCATGCCCTAAAGTCTACCCC
GCGCGTGGTAGACTCTCCCC

Downstream 100 bases:

>100_bases
GGGCGCTTGCCTCCACCCCCCGCCCCCTCCTCTACCTCCACCGGGGCGGGGGCGGCTTCTTTGACCTCCTCCTCGCCCAG
GTGACCAGAGCCCGCCTGCC

Product: UvrD protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 692; Mature: 691

Protein sequence:

>692_residues
MSDALLAPLNEAQRQAVLHFEGPALVVAGAGSGKTRTVVHRVAYLVARRGVFPSEILAVTFTNKAAEEMRERLRGLVPGA
GEVWVSTFHAAALRILRVYGERVGLRPGFVVYDEDDQTALLKEVLKELALSARPGPIKALLDRAKNRGVGLKALLGELPE
YYAGLSRGRLGDVLVRYQEALKAQGALDFGDILLYALRLLEEDEEVLRLVRKRARFIHVDEYQDTSPVQYRFTRLLAGEE
ANLMAVGDPDQGIYSFRAADIKNILDFTRDYPEARVYRLEENYRSTEAILRFANAVIVKNALRLEKALRPVKRGGEPVRL
YRAEDAREEARFVAEEIARLGPPWDRYAVLYRTNAQSRLLEQALAGRGIPARVVGGVGFFERAEVKDLLAYARLALNPLD
AVSLKRVLNTPPRGIGPATWARVQLLAQEKGLPPWEALKEAARTFSRPEPLRHFVALVEELQDLVFGPAEAFFRHLLEAT
DYPAYLREAYPEDAEDRLENVEELLRAAKEAEDLQDFLDRVALTAKAEEPAEAEGRVALMTLHNAKGLEFPVVFLVGVEE
GLLPHRNSVSTLEGLEEERRLFYVGITRAQERLYLSHAEEREVYGRREPARPSRFLEEVEEGLYEVYDPYRRPPSPPPHR
PRPGAFRGGERVVHPRFGPGTVVAAQGDEVTVHFEGFGLKRLSLKYAELKPA

Sequences:

>Translated_692_residues
MSDALLAPLNEAQRQAVLHFEGPALVVAGAGSGKTRTVVHRVAYLVARRGVFPSEILAVTFTNKAAEEMRERLRGLVPGA
GEVWVSTFHAAALRILRVYGERVGLRPGFVVYDEDDQTALLKEVLKELALSARPGPIKALLDRAKNRGVGLKALLGELPE
YYAGLSRGRLGDVLVRYQEALKAQGALDFGDILLYALRLLEEDEEVLRLVRKRARFIHVDEYQDTSPVQYRFTRLLAGEE
ANLMAVGDPDQGIYSFRAADIKNILDFTRDYPEARVYRLEENYRSTEAILRFANAVIVKNALRLEKALRPVKRGGEPVRL
YRAEDAREEARFVAEEIARLGPPWDRYAVLYRTNAQSRLLEQALAGRGIPARVVGGVGFFERAEVKDLLAYARLALNPLD
AVSLKRVLNTPPRGIGPATWARVQLLAQEKGLPPWEALKEAARTFSRPEPLRHFVALVEELQDLVFGPAEAFFRHLLEAT
DYPAYLREAYPEDAEDRLENVEELLRAAKEAEDLQDFLDRVALTAKAEEPAEAEGRVALMTLHNAKGLEFPVVFLVGVEE
GLLPHRNSVSTLEGLEEERRLFYVGITRAQERLYLSHAEEREVYGRREPARPSRFLEEVEEGLYEVYDPYRRPPSPPPHR
PRPGAFRGGERVVHPRFGPGTVVAAQGDEVTVHFEGFGLKRLSLKYAELKPA
>Mature_691_residues
SDALLAPLNEAQRQAVLHFEGPALVVAGAGSGKTRTVVHRVAYLVARRGVFPSEILAVTFTNKAAEEMRERLRGLVPGAG
EVWVSTFHAAALRILRVYGERVGLRPGFVVYDEDDQTALLKEVLKELALSARPGPIKALLDRAKNRGVGLKALLGELPEY
YAGLSRGRLGDVLVRYQEALKAQGALDFGDILLYALRLLEEDEEVLRLVRKRARFIHVDEYQDTSPVQYRFTRLLAGEEA
NLMAVGDPDQGIYSFRAADIKNILDFTRDYPEARVYRLEENYRSTEAILRFANAVIVKNALRLEKALRPVKRGGEPVRLY
RAEDAREEARFVAEEIARLGPPWDRYAVLYRTNAQSRLLEQALAGRGIPARVVGGVGFFERAEVKDLLAYARLALNPLDA
VSLKRVLNTPPRGIGPATWARVQLLAQEKGLPPWEALKEAARTFSRPEPLRHFVALVEELQDLVFGPAEAFFRHLLEATD
YPAYLREAYPEDAEDRLENVEELLRAAKEAEDLQDFLDRVALTAKAEEPAEAEGRVALMTLHNAKGLEFPVVFLVGVEEG
LLPHRNSVSTLEGLEEERRLFYVGITRAQERLYLSHAEEREVYGRREPARPSRFLEEVEEGLYEVYDPYRRPPSPPPHRP
RPGAFRGGERVVHPRFGPGTVVAAQGDEVTVHFEGFGLKRLSLKYAELKPA

Specific function: Essential helicase. May act as a helicase in plasmid pT181 replication [H]

COG id: COG0210

COG function: function code L; Superfamily I DNA and RNA helicases

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 uvrD-like helicase C-terminal domain [H]

Homologues:

Organism=Escherichia coli, GI2367296, Length=719, Percent_Identity=39.4993045897079, Blast_Score=444, Evalue=1e-125,
Organism=Escherichia coli, GI48994965, Length=639, Percent_Identity=38.3411580594679, Blast_Score=357, Evalue=1e-99,
Organism=Escherichia coli, GI1787196, Length=345, Percent_Identity=30.1449275362319, Blast_Score=110, Evalue=3e-25,
Organism=Saccharomyces cerevisiae, GI6322369, Length=759, Percent_Identity=28.0632411067194, Blast_Score=218, Evalue=2e-57,

Paralogues:

None

Copy number: 3000 [C]

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR005751
- InterPro:   IPR013986
- InterPro:   IPR014017
- InterPro:   IPR000212
- InterPro:   IPR014016 [H]

Pfam domain/function: PF00580 UvrD-helicase [H]

EC number: =3.6.4.12 [H]

Molecular weight: Translated: 77725; Mature: 77594

Theoretical pI: Translated: 6.55; Mature: 6.55

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.0 %Cys     (Translated Protein)
0.6 %Met     (Translated Protein)
0.6 %Cys+Met (Translated Protein)
0.0 %Cys     (Mature Protein)
0.4 %Met     (Mature Protein)
0.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSDALLAPLNEAQRQAVLHFEGPALVVAGAGSGKTRTVVHRVAYLVARRGVFPSEILAVT
CCCCCCCCHHHHHHHEEEEECCCEEEEEECCCCCHHHHHHHHHHHHHHCCCCCCCEEEEE
FTNKAAEEMRERLRGLVPGAGEVWVSTFHAAALRILRVYGERVGLRPGFVVYDEDDQTAL
ECCHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCEEEECCCCHHHH
LKEVLKELALSARPGPIKALLDRAKNRGVGLKALLGELPEYYAGLSRGRLGDVLVRYQEA
HHHHHHHHHHCCCCCHHHHHHHHHHCCCCCHHHHHHHHHHHHHCCCCCCHHHHHHHHHHH
LKAQGALDFGDILLYALRLLEEDEEVLRLVRKRARFIHVDEYQDTSPVQYRFTRLLAGEE
HHHCCCCCHHHHHHHHHHHHCCCHHHHHHHHHHHHEEEEECCCCCCCHHHHHHHHHCCCC
ANLMAVGDPDQGIYSFRAADIKNILDFTRDYPEARVYRLEENYRSTEAILRFANAVIVKN
CCEEEECCCCCCHHHHHHHHHHHHHHHHHCCCHHHEEEHHHHHHHHHHHHHHHHHHHHHH
ALRLEKALRPVKRGGEPVRLYRAEDAREEARFVAEEIARLGPPWDRYAVLYRTNAQSRLL
HHHHHHHHHHHHCCCCCEEEEECCCHHHHHHHHHHHHHHCCCCHHHEEEEEECCHHHHHH
EQALAGRGIPARVVGGVGFFERAEVKDLLAYARLALNPLDAVSLKRVLNTPPRGIGPATW
HHHHHCCCCCHHHHCCCCCHHHHHHHHHHHHHHHHCCCHHHHHHHHHHCCCCCCCCCHHH
ARVQLLAQEKGLPPWEALKEAARTFSRPEPLRHFVALVEELQDLVFGPAEAFFRHLLEAT
HHHHHHHHHCCCCHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHC
DYPAYLREAYPEDAEDRLENVEELLRAAKEAEDLQDFLDRVALTAKAEEPAEAEGRVALM
CCCHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCEEEE
TLHNAKGLEFPVVFLVGVEEGLLPHRNSVSTLEGLEEERRLFYVGITRAQERLYLSHAEE
EEECCCCCCCCEEEEEECCCCCCCCCCCHHHHHHHHHCCEEEEEEEHHHHHHHHHHCCHH
REVYGRREPARPSRFLEEVEEGLYEVYDPYRRPPSPPPHRPRPGAFRGGERVVHPRFGPG
HHHHCCCCCCCHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCEEECCCCCCC
TVVAAQGDEVTVHFEGFGLKRLSLKYAELKPA
EEEEECCCEEEEEECCCCEEHHEEEHHHCCCC
>Mature Secondary Structure 
SDALLAPLNEAQRQAVLHFEGPALVVAGAGSGKTRTVVHRVAYLVARRGVFPSEILAVT
CCCCCCCHHHHHHHEEEEECCCEEEEEECCCCCHHHHHHHHHHHHHHCCCCCCCEEEEE
FTNKAAEEMRERLRGLVPGAGEVWVSTFHAAALRILRVYGERVGLRPGFVVYDEDDQTAL
ECCHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCEEEECCCCHHHH
LKEVLKELALSARPGPIKALLDRAKNRGVGLKALLGELPEYYAGLSRGRLGDVLVRYQEA
HHHHHHHHHHCCCCCHHHHHHHHHHCCCCCHHHHHHHHHHHHHCCCCCCHHHHHHHHHHH
LKAQGALDFGDILLYALRLLEEDEEVLRLVRKRARFIHVDEYQDTSPVQYRFTRLLAGEE
HHHCCCCCHHHHHHHHHHHHCCCHHHHHHHHHHHHEEEEECCCCCCCHHHHHHHHHCCCC
ANLMAVGDPDQGIYSFRAADIKNILDFTRDYPEARVYRLEENYRSTEAILRFANAVIVKN
CCEEEECCCCCCHHHHHHHHHHHHHHHHHCCCHHHEEEHHHHHHHHHHHHHHHHHHHHHH
ALRLEKALRPVKRGGEPVRLYRAEDAREEARFVAEEIARLGPPWDRYAVLYRTNAQSRLL
HHHHHHHHHHHHCCCCCEEEEECCCHHHHHHHHHHHHHHCCCCHHHEEEEEECCHHHHHH
EQALAGRGIPARVVGGVGFFERAEVKDLLAYARLALNPLDAVSLKRVLNTPPRGIGPATW
HHHHHCCCCCHHHHCCCCCHHHHHHHHHHHHHHHHCCCHHHHHHHHHHCCCCCCCCCHHH
ARVQLLAQEKGLPPWEALKEAARTFSRPEPLRHFVALVEELQDLVFGPAEAFFRHLLEAT
HHHHHHHHHCCCCHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHC
DYPAYLREAYPEDAEDRLENVEELLRAAKEAEDLQDFLDRVALTAKAEEPAEAEGRVALM
CCCHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCEEEE
TLHNAKGLEFPVVFLVGVEEGLLPHRNSVSTLEGLEEERRLFYVGITRAQERLYLSHAEE
EEECCCCCCCCEEEEEECCCCCCCCCCCHHHHHHHHHCCEEEEEEEHHHHHHHHHHCCHH
REVYGRREPARPSRFLEEVEEGLYEVYDPYRRPPSPPPHRPRPGAFRGGERVVHPRFGPG
HHHHCCCCCCCHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCEEECCCCCCC
TVVAAQGDEVTVHFEGFGLKRLSLKYAELKPA
EEEEECCCEEEEEECCCCEEHHEEEHHHCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 8232203 [H]