Definition Treponema pallidum subsp. pallidum SS14, complete genome.
Accession NC_010741
Length 1,139,457

Click here to switch to the map view.

The map label for this gene is recQ [H]

Identifier: 189025337

GI number: 189025337

Start: 111785

End: 113608

Strand: Direct

Name: recQ [H]

Synonym: TPASS_0103

Alternate gene names: 189025337

Gene position: 111785-113608 (Clockwise)

Preceding gene: 189025335

Following gene: 189025338

Centisome position: 9.81

GC content: 52.74

Gene sequence:

>1824_bases
GTGGGTAATACTTCAGATTGGGTAGAGATGGATGGATTGCGCTATGTGTATGCCGCGCAGGGTGCGGCCCCCATGCCTGC
TCCTACGGATAATCCTGCTTGTGATGCGCACATGTCGCATGACGTCATAGCGCGTACTGCCCAAGCAGTTTTTGGTATTC
GTGCGCTGTTTCCTTGGCAGCGCTTGGTAATTGCTAACATACTGGATGCGGCGCATGCGTGTACACATACAACTCCGTTC
GCTGCGGCAGGTTCTTCTCAAACCGATGCTACGAGGGTGACTCATGTGGATGACGCGCAGCCTGAGGATAATTTCGTCGG
TGCCATGCAAGACACACGTTTTGATCAGGATGGCGTGTCACGCGCACATCAAGTGGTGCTATTGCCGACAGGTGCAGGAA
AATCGCTGTGTTTTCAAGTACCTGCCCTCTTTTTAGAGGGGCCGACGCTAGTGGTGTACCCACTGTTATCGCTCATGCGT
GATCAGTGCCGTCGGATGCAGGCAGTGGGATTTTCGGTCATCTTGTTACGTGGTGGACTGAATGCGCAAGAGCGCGCGTA
CATGTATGCGCAGTTGGATAGGTGTGCTGAGGCGTATGGCCGGATGCGAGGCGTTACGCCTCCTGCACACCAGACGGCAG
AATTTTCCCTTGCAGATTCGATCTCTTTTGATGCGTCACTCTTCTCTGATGACGTGAGTACCTTCTCGAAGGTGGTACAT
GTGGATGAACGTCTTGCTCAGAAAAGGACAGAAAGTCGAAGAGGTGTATGCATCATCGCAAGTCCAGAGATACTCACACA
ACCTGCGCTGCGCGCACGCGTGCGTGCATGTCGCGTTGCGCATTTGGTTATTGATGAAGCGCACTGTGTGTCCGAGTGGG
GAGATTCGTTTCGTCCTGATTACGTGCGACTAGGCGAATTGGTGCAGGATCTTGCGCCTCAAGTGGTGACTGCATTTACG
GCGACTGCAAGTCAAACAGTGCTTGCGCGCATCATGGAAGTGCTGTTTGGCGGTCGTGCGCACGTGTTGCAGGGAACAGT
AGATCGCCCGAACATTCGATACACCGTACGCACGGTGCTGTGTAAGCAGACGGCACTGACTCAACTTGTAGCGCGTTGTG
TGCGCCCTGCAGTTATTTTTTGTGCTCGTCGGGTACAGGTGGAGCGTGTAGCCCACCATTTGCGCACGTGTCTTTCTGAC
ACACAGATACGTTTTTATCACGCAGGGTTGCAGAGGGAAGAAAAAGAAACAGTGGAGCGATGGTTTCATACCCATGATTC
TGCCGTTTTGGTAACTACTTGCGCGTGGGGAATGGGAGTTGATAAGCCGAATGTACGTACGGTCATTCACGTGGATGCGC
CACTGACTGTGGAGGCGTACGTACAGGAGGTTGGAAGAGCAGGACGGGACGGAATGCGTGCAGACGCATTTTTATTGTGG
TCACCTCGAGATGCTCGCTCGATAGAAACACTGCCGCATGCACAACGGGTGCGTGCGCACGTGTTGCGCCACTTTGCTGA
AAGCGGACGTTGTCGCCGCGCAGTTTTACTTGAGTCTTTGGGGGAACAGAATGTGTGTGCCGGATGTGATGTGTGTGCAG
GCACTGCACGTTTTGTATGTGAGGATGTAGAAGCGCTCTTACAGTTTTTGAAAAAGAATGCGCGCAGATTCACTGTATCA
TCGTTGGTGCAGCACCTCGCGCTACATCAGAAAGTGCTCAGTGTGGCGGATGTACGTGCCTTGCTATATTACGCGCTCGA
AACAGGACGTGTGAAAAAAAAACATTCACTCTTGTGGGGTGATGTCCTGTATGTTGCACGTTAA

Upstream 100 bases:

>100_bases
GGCTCGACGTTGCTCAGGATTAAGTGTAGAGAGCATAGACGCACAAGCGTAGCAAAATAGGGCGGAAAAAAGAATATCCG
TATGTGGAAGGGCATAGACT

Downstream 100 bases:

>100_bases
CGATTCTGCGAGCAAATCGTATCTGCAGGAAAGCAAGAAGGATGGCGAGAACATACAGTTGCCTTGTATATTCCGCGAGT
TACGCGCATTTTTATGGCCG

Product: ATP-dependent DNA helicase

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 607; Mature: 606

Protein sequence:

>607_residues
MGNTSDWVEMDGLRYVYAAQGAAPMPAPTDNPACDAHMSHDVIARTAQAVFGIRALFPWQRLVIANILDAAHACTHTTPF
AAAGSSQTDATRVTHVDDAQPEDNFVGAMQDTRFDQDGVSRAHQVVLLPTGAGKSLCFQVPALFLEGPTLVVYPLLSLMR
DQCRRMQAVGFSVILLRGGLNAQERAYMYAQLDRCAEAYGRMRGVTPPAHQTAEFSLADSISFDASLFSDDVSTFSKVVH
VDERLAQKRTESRRGVCIIASPEILTQPALRARVRACRVAHLVIDEAHCVSEWGDSFRPDYVRLGELVQDLAPQVVTAFT
ATASQTVLARIMEVLFGGRAHVLQGTVDRPNIRYTVRTVLCKQTALTQLVARCVRPAVIFCARRVQVERVAHHLRTCLSD
TQIRFYHAGLQREEKETVERWFHTHDSAVLVTTCAWGMGVDKPNVRTVIHVDAPLTVEAYVQEVGRAGRDGMRADAFLLW
SPRDARSIETLPHAQRVRAHVLRHFAESGRCRRAVLLESLGEQNVCAGCDVCAGTARFVCEDVEALLQFLKKNARRFTVS
SLVQHLALHQKVLSVADVRALLYYALETGRVKKKHSLLWGDVLYVAR

Sequences:

>Translated_607_residues
MGNTSDWVEMDGLRYVYAAQGAAPMPAPTDNPACDAHMSHDVIARTAQAVFGIRALFPWQRLVIANILDAAHACTHTTPF
AAAGSSQTDATRVTHVDDAQPEDNFVGAMQDTRFDQDGVSRAHQVVLLPTGAGKSLCFQVPALFLEGPTLVVYPLLSLMR
DQCRRMQAVGFSVILLRGGLNAQERAYMYAQLDRCAEAYGRMRGVTPPAHQTAEFSLADSISFDASLFSDDVSTFSKVVH
VDERLAQKRTESRRGVCIIASPEILTQPALRARVRACRVAHLVIDEAHCVSEWGDSFRPDYVRLGELVQDLAPQVVTAFT
ATASQTVLARIMEVLFGGRAHVLQGTVDRPNIRYTVRTVLCKQTALTQLVARCVRPAVIFCARRVQVERVAHHLRTCLSD
TQIRFYHAGLQREEKETVERWFHTHDSAVLVTTCAWGMGVDKPNVRTVIHVDAPLTVEAYVQEVGRAGRDGMRADAFLLW
SPRDARSIETLPHAQRVRAHVLRHFAESGRCRRAVLLESLGEQNVCAGCDVCAGTARFVCEDVEALLQFLKKNARRFTVS
SLVQHLALHQKVLSVADVRALLYYALETGRVKKKHSLLWGDVLYVAR
>Mature_606_residues
GNTSDWVEMDGLRYVYAAQGAAPMPAPTDNPACDAHMSHDVIARTAQAVFGIRALFPWQRLVIANILDAAHACTHTTPFA
AAGSSQTDATRVTHVDDAQPEDNFVGAMQDTRFDQDGVSRAHQVVLLPTGAGKSLCFQVPALFLEGPTLVVYPLLSLMRD
QCRRMQAVGFSVILLRGGLNAQERAYMYAQLDRCAEAYGRMRGVTPPAHQTAEFSLADSISFDASLFSDDVSTFSKVVHV
DERLAQKRTESRRGVCIIASPEILTQPALRARVRACRVAHLVIDEAHCVSEWGDSFRPDYVRLGELVQDLAPQVVTAFTA
TASQTVLARIMEVLFGGRAHVLQGTVDRPNIRYTVRTVLCKQTALTQLVARCVRPAVIFCARRVQVERVAHHLRTCLSDT
QIRFYHAGLQREEKETVERWFHTHDSAVLVTTCAWGMGVDKPNVRTVIHVDAPLTVEAYVQEVGRAGRDGMRADAFLLWS
PRDARSIETLPHAQRVRAHVLRHFAESGRCRRAVLLESLGEQNVCAGCDVCAGTARFVCEDVEALLQFLKKNARRFTVSS
LVQHLALHQKVLSVADVRALLYYALETGRVKKKHSLLWGDVLYVAR

Specific function: DNA helicase [H]

COG id: COG0514

COG function: function code L; Superfamily II DNA helicase

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 HRDC domain [H]

Homologues:

Organism=Homo sapiens, GI14591902, Length=445, Percent_Identity=27.8651685393258, Blast_Score=178, Evalue=1e-44,
Organism=Homo sapiens, GI14591904, Length=445, Percent_Identity=27.8651685393258, Blast_Score=178, Evalue=1e-44,
Organism=Homo sapiens, GI4557365, Length=460, Percent_Identity=30.8695652173913, Blast_Score=176, Evalue=5e-44,
Organism=Homo sapiens, GI148612816, Length=439, Percent_Identity=30.2961275626424, Blast_Score=158, Evalue=1e-38,
Organism=Homo sapiens, GI51242943, Length=379, Percent_Identity=31.1345646437995, Blast_Score=158, Evalue=2e-38,
Organism=Homo sapiens, GI51242947, Length=379, Percent_Identity=31.1345646437995, Blast_Score=158, Evalue=2e-38,
Organism=Homo sapiens, GI110735439, Length=284, Percent_Identity=31.3380281690141, Blast_Score=137, Evalue=3e-32,
Organism=Homo sapiens, GI169218196, Length=284, Percent_Identity=31.3380281690141, Blast_Score=137, Evalue=3e-32,
Organism=Homo sapiens, GI284005309, Length=236, Percent_Identity=34.7457627118644, Blast_Score=120, Evalue=4e-27,
Organism=Escherichia coli, GI48994977, Length=301, Percent_Identity=36.5448504983389, Blast_Score=181, Evalue=2e-46,
Organism=Caenorhabditis elegans, GI25145561, Length=432, Percent_Identity=31.25, Blast_Score=183, Evalue=2e-46,
Organism=Caenorhabditis elegans, GI71987993, Length=435, Percent_Identity=28.0459770114943, Blast_Score=165, Evalue=7e-41,
Organism=Caenorhabditis elegans, GI71987997, Length=435, Percent_Identity=28.0459770114943, Blast_Score=165, Evalue=7e-41,
Organism=Caenorhabditis elegans, GI17552866, Length=472, Percent_Identity=27.5423728813559, Blast_Score=147, Evalue=1e-35,
Organism=Caenorhabditis elegans, GI32564293, Length=282, Percent_Identity=31.5602836879433, Blast_Score=126, Evalue=3e-29,
Organism=Saccharomyces cerevisiae, GI6323844, Length=442, Percent_Identity=28.2805429864253, Blast_Score=168, Evalue=3e-42,
Organism=Saccharomyces cerevisiae, GI6321360, Length=250, Percent_Identity=24, Blast_Score=67, Evalue=1e-11,
Organism=Drosophila melanogaster, GI24646066, Length=456, Percent_Identity=29.6052631578947, Blast_Score=170, Evalue=3e-42,
Organism=Drosophila melanogaster, GI24664230, Length=306, Percent_Identity=32.3529411764706, Blast_Score=138, Evalue=1e-32,
Organism=Drosophila melanogaster, GI62472181, Length=306, Percent_Identity=32.3529411764706, Blast_Score=138, Evalue=1e-32,
Organism=Drosophila melanogaster, GI24664226, Length=295, Percent_Identity=32.8813559322034, Blast_Score=138, Evalue=1e-32,
Organism=Drosophila melanogaster, GI21358123, Length=355, Percent_Identity=28.7323943661972, Blast_Score=132, Evalue=9e-31,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR014001
- InterPro:   IPR011545
- InterPro:   IPR004589
- InterPro:   IPR006293
- InterPro:   IPR002121
- InterPro:   IPR001650
- InterPro:   IPR014021
- InterPro:   IPR010997
- InterPro:   IPR018982 [H]

Pfam domain/function: PF00270 DEAD; PF00271 Helicase_C; PF00570 HRDC; PF09382 RQC [H]

EC number: =3.6.4.12 [H]

Molecular weight: Translated: 67287; Mature: 67156

Theoretical pI: Translated: 8.20; Mature: 8.20

Prosite motif: PS00690 DEAH_ATP_HELICASE

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

3.0 %Cys     (Translated Protein)
2.0 %Met     (Translated Protein)
4.9 %Cys+Met (Translated Protein)
3.0 %Cys     (Mature Protein)
1.8 %Met     (Mature Protein)
4.8 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MGNTSDWVEMDGLRYVYAAQGAAPMPAPTDNPACDAHMSHDVIARTAQAVFGIRALFPWQ
CCCCCCCEECCCCEEEEEECCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHH
RLVIANILDAAHACTHTTPFAAAGSSQTDATRVTHVDDAQPEDNFVGAMQDTRFDQDGVS
HHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCEEEECCCCCCCCCCCCCHHHCCCCHHHHH
RAHQVVLLPTGAGKSLCFQVPALFLEGPTLVVYPLLSLMRDQCRRMQAVGFSVILLRGGL
CCCEEEEEECCCCCHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHCCCEEEEEECCC
NAQERAYMYAQLDRCAEAYGRMRGVTPPAHQTAEFSLADSISFDASLFSDDVSTFSKVVH
CHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCEEHHHCCCCCHHHHHHHHHHHHHHHH
VDERLAQKRTESRRGVCIIASPEILTQPALRARVRACRVAHLVIDEAHCVSEWGDSFRPD
HHHHHHHHHHHHHCCEEEEECCHHHHCHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCH
YVRLGELVQDLAPQVVTAFTATASQTVLARIMEVLFGGRAHVLQGTVDRPNIRYTVRTVL
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHEEECCCCCCCCHHHHHHHH
CKQTALTQLVARCVRPAVIFCARRVQVERVAHHLRTCLSDTQIRFYHAGLQREEKETVER
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEEECCCCHHHHHHHHH
WFHTHDSAVLVTTCAWGMGVDKPNVRTVIHVDAPLTVEAYVQEVGRAGRDGMRADAFLLW
HHHCCCCEEEEEEEHHCCCCCCCCCEEEEEECCCCHHHHHHHHHHHCCCCCCCCCEEEEE
SPRDARSIETLPHAQRVRAHVLRHFAESGRCRRAVLLESLGEQNVCAGCDVCAGTARFVC
CCCCCCHHHHCCHHHHHHHHHHHHHHHCCCHHHHHHHHHCCCCCCCCCCCHHCCHHHHHH
EDVEALLQFLKKNARRFTVSSLVQHLALHQKVLSVADVRALLYYALETGRVKKKHSLLWG
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHH
DVLYVAR
HHHEECC
>Mature Secondary Structure 
GNTSDWVEMDGLRYVYAAQGAAPMPAPTDNPACDAHMSHDVIARTAQAVFGIRALFPWQ
CCCCCCEECCCCEEEEEECCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHH
RLVIANILDAAHACTHTTPFAAAGSSQTDATRVTHVDDAQPEDNFVGAMQDTRFDQDGVS
HHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCEEEECCCCCCCCCCCCCHHHCCCCHHHHH
RAHQVVLLPTGAGKSLCFQVPALFLEGPTLVVYPLLSLMRDQCRRMQAVGFSVILLRGGL
CCCEEEEEECCCCCHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHCCCEEEEEECCC
NAQERAYMYAQLDRCAEAYGRMRGVTPPAHQTAEFSLADSISFDASLFSDDVSTFSKVVH
CHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCEEHHHCCCCCHHHHHHHHHHHHHHHH
VDERLAQKRTESRRGVCIIASPEILTQPALRARVRACRVAHLVIDEAHCVSEWGDSFRPD
HHHHHHHHHHHHHCCEEEEECCHHHHCHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCH
YVRLGELVQDLAPQVVTAFTATASQTVLARIMEVLFGGRAHVLQGTVDRPNIRYTVRTVL
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHEEECCCCCCCCHHHHHHHH
CKQTALTQLVARCVRPAVIFCARRVQVERVAHHLRTCLSDTQIRFYHAGLQREEKETVER
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEEECCCCHHHHHHHHH
WFHTHDSAVLVTTCAWGMGVDKPNVRTVIHVDAPLTVEAYVQEVGRAGRDGMRADAFLLW
HHHCCCCEEEEEEEHHCCCCCCCCCEEEEEECCCCHHHHHHHHHHHCCCCCCCCCEEEEE
SPRDARSIETLPHAQRVRAHVLRHFAESGRCRRAVLLESLGEQNVCAGCDVCAGTARFVC
CCCCCCHHHHCCHHHHHHHHHHHHHHHCCCHHHHHHHHHCCCCCCCCCCCHHCCHHHHHH
EDVEALLQFLKKNARRFTVSSLVQHLALHQKVLSVADVRALLYYALETGRVKKKHSLLWG
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHH
DVLYVAR
HHHEECC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 11248100 [H]