| Definition | Treponema pallidum subsp. pallidum SS14, complete genome. |
|---|---|
| Accession | NC_010741 |
| Length | 1,139,457 |
Click here to switch to the map view.
The map label for this gene is recQ [H]
Identifier: 189025337
GI number: 189025337
Start: 111785
End: 113608
Strand: Direct
Name: recQ [H]
Synonym: TPASS_0103
Alternate gene names: 189025337
Gene position: 111785-113608 (Clockwise)
Preceding gene: 189025335
Following gene: 189025338
Centisome position: 9.81
GC content: 52.74
Gene sequence:
>1824_bases GTGGGTAATACTTCAGATTGGGTAGAGATGGATGGATTGCGCTATGTGTATGCCGCGCAGGGTGCGGCCCCCATGCCTGC TCCTACGGATAATCCTGCTTGTGATGCGCACATGTCGCATGACGTCATAGCGCGTACTGCCCAAGCAGTTTTTGGTATTC GTGCGCTGTTTCCTTGGCAGCGCTTGGTAATTGCTAACATACTGGATGCGGCGCATGCGTGTACACATACAACTCCGTTC GCTGCGGCAGGTTCTTCTCAAACCGATGCTACGAGGGTGACTCATGTGGATGACGCGCAGCCTGAGGATAATTTCGTCGG TGCCATGCAAGACACACGTTTTGATCAGGATGGCGTGTCACGCGCACATCAAGTGGTGCTATTGCCGACAGGTGCAGGAA AATCGCTGTGTTTTCAAGTACCTGCCCTCTTTTTAGAGGGGCCGACGCTAGTGGTGTACCCACTGTTATCGCTCATGCGT GATCAGTGCCGTCGGATGCAGGCAGTGGGATTTTCGGTCATCTTGTTACGTGGTGGACTGAATGCGCAAGAGCGCGCGTA CATGTATGCGCAGTTGGATAGGTGTGCTGAGGCGTATGGCCGGATGCGAGGCGTTACGCCTCCTGCACACCAGACGGCAG AATTTTCCCTTGCAGATTCGATCTCTTTTGATGCGTCACTCTTCTCTGATGACGTGAGTACCTTCTCGAAGGTGGTACAT GTGGATGAACGTCTTGCTCAGAAAAGGACAGAAAGTCGAAGAGGTGTATGCATCATCGCAAGTCCAGAGATACTCACACA ACCTGCGCTGCGCGCACGCGTGCGTGCATGTCGCGTTGCGCATTTGGTTATTGATGAAGCGCACTGTGTGTCCGAGTGGG GAGATTCGTTTCGTCCTGATTACGTGCGACTAGGCGAATTGGTGCAGGATCTTGCGCCTCAAGTGGTGACTGCATTTACG GCGACTGCAAGTCAAACAGTGCTTGCGCGCATCATGGAAGTGCTGTTTGGCGGTCGTGCGCACGTGTTGCAGGGAACAGT AGATCGCCCGAACATTCGATACACCGTACGCACGGTGCTGTGTAAGCAGACGGCACTGACTCAACTTGTAGCGCGTTGTG TGCGCCCTGCAGTTATTTTTTGTGCTCGTCGGGTACAGGTGGAGCGTGTAGCCCACCATTTGCGCACGTGTCTTTCTGAC ACACAGATACGTTTTTATCACGCAGGGTTGCAGAGGGAAGAAAAAGAAACAGTGGAGCGATGGTTTCATACCCATGATTC TGCCGTTTTGGTAACTACTTGCGCGTGGGGAATGGGAGTTGATAAGCCGAATGTACGTACGGTCATTCACGTGGATGCGC CACTGACTGTGGAGGCGTACGTACAGGAGGTTGGAAGAGCAGGACGGGACGGAATGCGTGCAGACGCATTTTTATTGTGG TCACCTCGAGATGCTCGCTCGATAGAAACACTGCCGCATGCACAACGGGTGCGTGCGCACGTGTTGCGCCACTTTGCTGA AAGCGGACGTTGTCGCCGCGCAGTTTTACTTGAGTCTTTGGGGGAACAGAATGTGTGTGCCGGATGTGATGTGTGTGCAG GCACTGCACGTTTTGTATGTGAGGATGTAGAAGCGCTCTTACAGTTTTTGAAAAAGAATGCGCGCAGATTCACTGTATCA TCGTTGGTGCAGCACCTCGCGCTACATCAGAAAGTGCTCAGTGTGGCGGATGTACGTGCCTTGCTATATTACGCGCTCGA AACAGGACGTGTGAAAAAAAAACATTCACTCTTGTGGGGTGATGTCCTGTATGTTGCACGTTAA
Upstream 100 bases:
>100_bases GGCTCGACGTTGCTCAGGATTAAGTGTAGAGAGCATAGACGCACAAGCGTAGCAAAATAGGGCGGAAAAAAGAATATCCG TATGTGGAAGGGCATAGACT
Downstream 100 bases:
>100_bases CGATTCTGCGAGCAAATCGTATCTGCAGGAAAGCAAGAAGGATGGCGAGAACATACAGTTGCCTTGTATATTCCGCGAGT TACGCGCATTTTTATGGCCG
Product: ATP-dependent DNA helicase
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 607; Mature: 606
Protein sequence:
>607_residues MGNTSDWVEMDGLRYVYAAQGAAPMPAPTDNPACDAHMSHDVIARTAQAVFGIRALFPWQRLVIANILDAAHACTHTTPF AAAGSSQTDATRVTHVDDAQPEDNFVGAMQDTRFDQDGVSRAHQVVLLPTGAGKSLCFQVPALFLEGPTLVVYPLLSLMR DQCRRMQAVGFSVILLRGGLNAQERAYMYAQLDRCAEAYGRMRGVTPPAHQTAEFSLADSISFDASLFSDDVSTFSKVVH VDERLAQKRTESRRGVCIIASPEILTQPALRARVRACRVAHLVIDEAHCVSEWGDSFRPDYVRLGELVQDLAPQVVTAFT ATASQTVLARIMEVLFGGRAHVLQGTVDRPNIRYTVRTVLCKQTALTQLVARCVRPAVIFCARRVQVERVAHHLRTCLSD TQIRFYHAGLQREEKETVERWFHTHDSAVLVTTCAWGMGVDKPNVRTVIHVDAPLTVEAYVQEVGRAGRDGMRADAFLLW SPRDARSIETLPHAQRVRAHVLRHFAESGRCRRAVLLESLGEQNVCAGCDVCAGTARFVCEDVEALLQFLKKNARRFTVS SLVQHLALHQKVLSVADVRALLYYALETGRVKKKHSLLWGDVLYVAR
Sequences:
>Translated_607_residues MGNTSDWVEMDGLRYVYAAQGAAPMPAPTDNPACDAHMSHDVIARTAQAVFGIRALFPWQRLVIANILDAAHACTHTTPF AAAGSSQTDATRVTHVDDAQPEDNFVGAMQDTRFDQDGVSRAHQVVLLPTGAGKSLCFQVPALFLEGPTLVVYPLLSLMR DQCRRMQAVGFSVILLRGGLNAQERAYMYAQLDRCAEAYGRMRGVTPPAHQTAEFSLADSISFDASLFSDDVSTFSKVVH VDERLAQKRTESRRGVCIIASPEILTQPALRARVRACRVAHLVIDEAHCVSEWGDSFRPDYVRLGELVQDLAPQVVTAFT ATASQTVLARIMEVLFGGRAHVLQGTVDRPNIRYTVRTVLCKQTALTQLVARCVRPAVIFCARRVQVERVAHHLRTCLSD TQIRFYHAGLQREEKETVERWFHTHDSAVLVTTCAWGMGVDKPNVRTVIHVDAPLTVEAYVQEVGRAGRDGMRADAFLLW SPRDARSIETLPHAQRVRAHVLRHFAESGRCRRAVLLESLGEQNVCAGCDVCAGTARFVCEDVEALLQFLKKNARRFTVS SLVQHLALHQKVLSVADVRALLYYALETGRVKKKHSLLWGDVLYVAR >Mature_606_residues GNTSDWVEMDGLRYVYAAQGAAPMPAPTDNPACDAHMSHDVIARTAQAVFGIRALFPWQRLVIANILDAAHACTHTTPFA AAGSSQTDATRVTHVDDAQPEDNFVGAMQDTRFDQDGVSRAHQVVLLPTGAGKSLCFQVPALFLEGPTLVVYPLLSLMRD QCRRMQAVGFSVILLRGGLNAQERAYMYAQLDRCAEAYGRMRGVTPPAHQTAEFSLADSISFDASLFSDDVSTFSKVVHV DERLAQKRTESRRGVCIIASPEILTQPALRARVRACRVAHLVIDEAHCVSEWGDSFRPDYVRLGELVQDLAPQVVTAFTA TASQTVLARIMEVLFGGRAHVLQGTVDRPNIRYTVRTVLCKQTALTQLVARCVRPAVIFCARRVQVERVAHHLRTCLSDT QIRFYHAGLQREEKETVERWFHTHDSAVLVTTCAWGMGVDKPNVRTVIHVDAPLTVEAYVQEVGRAGRDGMRADAFLLWS PRDARSIETLPHAQRVRAHVLRHFAESGRCRRAVLLESLGEQNVCAGCDVCAGTARFVCEDVEALLQFLKKNARRFTVSS LVQHLALHQKVLSVADVRALLYYALETGRVKKKHSLLWGDVLYVAR
Specific function: DNA helicase [H]
COG id: COG0514
COG function: function code L; Superfamily II DNA helicase
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 1 HRDC domain [H]
Homologues:
Organism=Homo sapiens, GI14591902, Length=445, Percent_Identity=27.8651685393258, Blast_Score=178, Evalue=1e-44, Organism=Homo sapiens, GI14591904, Length=445, Percent_Identity=27.8651685393258, Blast_Score=178, Evalue=1e-44, Organism=Homo sapiens, GI4557365, Length=460, Percent_Identity=30.8695652173913, Blast_Score=176, Evalue=5e-44, Organism=Homo sapiens, GI148612816, Length=439, Percent_Identity=30.2961275626424, Blast_Score=158, Evalue=1e-38, Organism=Homo sapiens, GI51242943, Length=379, Percent_Identity=31.1345646437995, Blast_Score=158, Evalue=2e-38, Organism=Homo sapiens, GI51242947, Length=379, Percent_Identity=31.1345646437995, Blast_Score=158, Evalue=2e-38, Organism=Homo sapiens, GI110735439, Length=284, Percent_Identity=31.3380281690141, Blast_Score=137, Evalue=3e-32, Organism=Homo sapiens, GI169218196, Length=284, Percent_Identity=31.3380281690141, Blast_Score=137, Evalue=3e-32, Organism=Homo sapiens, GI284005309, Length=236, Percent_Identity=34.7457627118644, Blast_Score=120, Evalue=4e-27, Organism=Escherichia coli, GI48994977, Length=301, Percent_Identity=36.5448504983389, Blast_Score=181, Evalue=2e-46, Organism=Caenorhabditis elegans, GI25145561, Length=432, Percent_Identity=31.25, Blast_Score=183, Evalue=2e-46, Organism=Caenorhabditis elegans, GI71987993, Length=435, Percent_Identity=28.0459770114943, Blast_Score=165, Evalue=7e-41, Organism=Caenorhabditis elegans, GI71987997, Length=435, Percent_Identity=28.0459770114943, Blast_Score=165, Evalue=7e-41, Organism=Caenorhabditis elegans, GI17552866, Length=472, Percent_Identity=27.5423728813559, Blast_Score=147, Evalue=1e-35, Organism=Caenorhabditis elegans, GI32564293, Length=282, Percent_Identity=31.5602836879433, Blast_Score=126, Evalue=3e-29, Organism=Saccharomyces cerevisiae, GI6323844, Length=442, Percent_Identity=28.2805429864253, Blast_Score=168, Evalue=3e-42, Organism=Saccharomyces cerevisiae, GI6321360, Length=250, Percent_Identity=24, Blast_Score=67, Evalue=1e-11, Organism=Drosophila melanogaster, GI24646066, Length=456, Percent_Identity=29.6052631578947, Blast_Score=170, Evalue=3e-42, Organism=Drosophila melanogaster, GI24664230, Length=306, Percent_Identity=32.3529411764706, Blast_Score=138, Evalue=1e-32, Organism=Drosophila melanogaster, GI62472181, Length=306, Percent_Identity=32.3529411764706, Blast_Score=138, Evalue=1e-32, Organism=Drosophila melanogaster, GI24664226, Length=295, Percent_Identity=32.8813559322034, Blast_Score=138, Evalue=1e-32, Organism=Drosophila melanogaster, GI21358123, Length=355, Percent_Identity=28.7323943661972, Blast_Score=132, Evalue=9e-31,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR014001 - InterPro: IPR011545 - InterPro: IPR004589 - InterPro: IPR006293 - InterPro: IPR002121 - InterPro: IPR001650 - InterPro: IPR014021 - InterPro: IPR010997 - InterPro: IPR018982 [H]
Pfam domain/function: PF00270 DEAD; PF00271 Helicase_C; PF00570 HRDC; PF09382 RQC [H]
EC number: =3.6.4.12 [H]
Molecular weight: Translated: 67287; Mature: 67156
Theoretical pI: Translated: 8.20; Mature: 8.20
Prosite motif: PS00690 DEAH_ATP_HELICASE
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
3.0 %Cys (Translated Protein) 2.0 %Met (Translated Protein) 4.9 %Cys+Met (Translated Protein) 3.0 %Cys (Mature Protein) 1.8 %Met (Mature Protein) 4.8 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MGNTSDWVEMDGLRYVYAAQGAAPMPAPTDNPACDAHMSHDVIARTAQAVFGIRALFPWQ CCCCCCCEECCCCEEEEEECCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHH RLVIANILDAAHACTHTTPFAAAGSSQTDATRVTHVDDAQPEDNFVGAMQDTRFDQDGVS HHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCEEEECCCCCCCCCCCCCHHHCCCCHHHHH RAHQVVLLPTGAGKSLCFQVPALFLEGPTLVVYPLLSLMRDQCRRMQAVGFSVILLRGGL CCCEEEEEECCCCCHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHCCCEEEEEECCC NAQERAYMYAQLDRCAEAYGRMRGVTPPAHQTAEFSLADSISFDASLFSDDVSTFSKVVH CHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCEEHHHCCCCCHHHHHHHHHHHHHHHH VDERLAQKRTESRRGVCIIASPEILTQPALRARVRACRVAHLVIDEAHCVSEWGDSFRPD HHHHHHHHHHHHHCCEEEEECCHHHHCHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCH YVRLGELVQDLAPQVVTAFTATASQTVLARIMEVLFGGRAHVLQGTVDRPNIRYTVRTVL HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHEEECCCCCCCCHHHHHHHH CKQTALTQLVARCVRPAVIFCARRVQVERVAHHLRTCLSDTQIRFYHAGLQREEKETVER HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEEECCCCHHHHHHHHH WFHTHDSAVLVTTCAWGMGVDKPNVRTVIHVDAPLTVEAYVQEVGRAGRDGMRADAFLLW HHHCCCCEEEEEEEHHCCCCCCCCCEEEEEECCCCHHHHHHHHHHHCCCCCCCCCEEEEE SPRDARSIETLPHAQRVRAHVLRHFAESGRCRRAVLLESLGEQNVCAGCDVCAGTARFVC CCCCCCHHHHCCHHHHHHHHHHHHHHHCCCHHHHHHHHHCCCCCCCCCCCHHCCHHHHHH EDVEALLQFLKKNARRFTVSSLVQHLALHQKVLSVADVRALLYYALETGRVKKKHSLLWG HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHH DVLYVAR HHHEECC >Mature Secondary Structure GNTSDWVEMDGLRYVYAAQGAAPMPAPTDNPACDAHMSHDVIARTAQAVFGIRALFPWQ CCCCCCEECCCCEEEEEECCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHH RLVIANILDAAHACTHTTPFAAAGSSQTDATRVTHVDDAQPEDNFVGAMQDTRFDQDGVS HHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCEEEECCCCCCCCCCCCCHHHCCCCHHHHH RAHQVVLLPTGAGKSLCFQVPALFLEGPTLVVYPLLSLMRDQCRRMQAVGFSVILLRGGL CCCEEEEEECCCCCHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHCCCEEEEEECCC NAQERAYMYAQLDRCAEAYGRMRGVTPPAHQTAEFSLADSISFDASLFSDDVSTFSKVVH CHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCEEHHHCCCCCHHHHHHHHHHHHHHHH VDERLAQKRTESRRGVCIIASPEILTQPALRARVRACRVAHLVIDEAHCVSEWGDSFRPD HHHHHHHHHHHHHCCEEEEECCHHHHCHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCH YVRLGELVQDLAPQVVTAFTATASQTVLARIMEVLFGGRAHVLQGTVDRPNIRYTVRTVL HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHEEECCCCCCCCHHHHHHHH CKQTALTQLVARCVRPAVIFCARRVQVERVAHHLRTCLSDTQIRFYHAGLQREEKETVER HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEEECCCCHHHHHHHHH WFHTHDSAVLVTTCAWGMGVDKPNVRTVIHVDAPLTVEAYVQEVGRAGRDGMRADAFLLW HHHCCCCEEEEEEEHHCCCCCCCCCEEEEEECCCCHHHHHHHHHHHCCCCCCCCCEEEEE SPRDARSIETLPHAQRVRAHVLRHFAESGRCRRAVLLESLGEQNVCAGCDVCAGTARFVC CCCCCCHHHHCCHHHHHHHHHHHHHHHCCCHHHHHHHHHCCCCCCCCCCCHHCCHHHHHH EDVEALLQFLKKNARRFTVSSLVQHLALHQKVLSVADVRALLYYALETGRVKKKHSLLWG HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHH DVLYVAR HHHEECC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 11248100 [H]