Definition Thermus thermophilus HB8 chromosome, complete genome.
Accession NC_006461
Length 1,849,742

Click here to switch to the map view.

The map label for this gene is yqhH [H]

Identifier: 55980989

GI number: 55980989

Start: 967685

End: 971017

Strand: Reverse

Name: yqhH [H]

Synonym: TTHA1020

Alternate gene names: 55980989

Gene position: 971017-967685 (Counterclockwise)

Preceding gene: 55980998

Following gene: 55980988

Centisome position: 52.49

GC content: 66.82

Gene sequence:

>3333_bases
ATGGGCTTCGGTTTAGACCCGAAAGACCTTCGCCCCGGGGACGTCCTCGAGGGCGATTGCTTCCCCGAGCCCGTCCGGGT
TATCCAGATCCAGGTGTGGGGCGACCTCTTCCGCCTCGAGGCCGTGGGCACGAGAACCCAGGGGTACTACGACCGCGTCC
TCTCCATCCAGGACTTGGGAAGCCTACGGCGGTTCCGGGCGAGCGGAGGTCGGGACTTTGGGGGAGCGCCCGAGGCCTTC
TTCCTGGCGGTGGAGGGGCACCGCATCCGCTTCGCCCAGCAGTTTGACCCCCTTTTCGCCGTGAACGTCTCCCAGATTGA
CCCGCTACCCCACCAGATCGAGGCGGTCTACTTCTACATCCTCCGGAACCCCAGGGTGCGCTTTCTGCTAGCCGACGATC
CGGGGGCGGGCAAGACCATCATGGCCGGGTTGCTTCTCAAGGAGCTGAAGTACAGGGGCCTGGTCCAGCGCACCCTGATC
GTGGTGCCCGGCCACCTCAAGGACCAGTGGCGGCGGGAGATGAAGGAGCGCTTCGCCGAGACCTTCCTGGTGGTGGACCG
GGGGATGGTGGAGGCCAACTGGGGCCGCAACGTCTGGCGGGAACATCCCCAGGTGATCACCTCCATGGACTTCGCTAAGC
GGGACGAGGTGCTCGCCTCCTTGGCCGAGGCCGATTGGGACCTGGTGATCGTGGACGAGGCCCACAAGATGACCGCCTAC
CGCTACGGGGAGAAGACCCACAAGACAGAGCGCTACCGTCTTGGGGAGCTCCTCTCCCGCACCAGCCAGTTTCTCCTCTT
CCTCACGGCCACGCCCCACCGGGGTGACCCGGAGAACTTCCGCCTCTTTCTGGACCTCTTGGAGCCCGGTTTCTTCGCCT
CCCGGGAGCTCCTCCTCGAGTCCATCGCCCGGAAGGACAACCCCCTTTTCCTGCGCAGGCTCAAGGAAGACCTCAAGGAC
TTTGAGGGGAGGCGCCTTTTCCCACCCCGCAAGGTCTTTACGGTGACCTACTACCTGAGCGACGAGGAGAAGCTCCTCTA
CAACGCCGTCACGAGCTACGTGGAAGCCTCCTACAACAAGGCCCTGGCCAGGGAGAAGCGGAACGTGGCCTTCGCGCTCC
TCATCCTGCAGCGGAGGCTGGCCTCGAGCGTGCGGGCCGTGCGCCGCTCGCTGGAAAGGCGCCGGGAGCGGCTTGCCCAG
CTTTTGGAGGTGGGCCGGTGGCTTGCGGAGCGGGGCGAGGTAGACGAGGAGGCCCTGGAGGACCTGGAGGAATGGGAACG
CCTCAAGCGGGAAGAGGATCTGGTGGCGCAACTCACCGCCGCCGAGACCCGGGAGGAGCTGGAGCGCGAGATCGCCCAGC
TGGACGAGCTCATTGCCTTGGCCCGGCGGGCCGAGCGGCTGGAGATTGAAACCAAGCTCCGCAAGCTCCGGGAGGTGATG
GAGGACGAAAGGCTCCAGCAGACGGGCGAAAAGCTCCTCATCTTCACCGAGTCCCGGGAAACCCTGGAGTACCTCGTGGA
GAAGCTTCGGGGGTGGGGGTACTCCGTGGTGTCCCTCCACGGGGGGATGGACCTGGACGCCCGCATCCGGGCCGAGCACG
AGTTCCGCGAGCGGGCCCAGGTGATGGTGTCCACCGAGGCGGGCGGGGAAGGCATCAACCTCCAGTTCTGCTCCCTCATG
GTCAACTACGACATTCCCTGGAACCCCAACCGCCTGGAGCAGCGGATGGGGCGGGTCCACCGCTACGGCCAGACCAAGGA
AGTGCACATCTACAACCTGGTGGCGCTGGACACCCGGGAGGGGAAGGTCCTCGAGGCCCTCTTCCGCAAGCTCAGGGAGA
TCCAGGAGGCCCTGGGGAGCGACCGGGTCTTTGACGTGGTGGGGGAGGTGCTCCCGGGAAAGAGCCTGAAGGAACTCATC
GTGGAGGCTATCGCCAACCGGCGCACCCTGGACGAGATCGTCTGCGAGATTGAGGCCGTGCCCGACCAGGAGGCGGTCCG
GCGGGTGCGGGAGGCGGCCCTCGAGGCCCTGGCGGTGCGCCACATTGACCTCACCCAGGTCCTGGGAGAGGAGCGGAGGG
CCCGGGAGAACCGCCTGGTGCCGGAGTACATTGAGCGCTTCTTTGAGCGGGCCTGCAGGTTCTTGGGCGTGCCCCTGGAG
CGGCGCGGGGACGGCTTATGGCGCGTCCCCCGCGTTCCCCATGAGCTGCGGGACCTTTCCCGGGAGTTCAAGGACCGCTA
CGGCGAGGTCTTCCCCGAGTACCGGAAGCTGGCCTTCTCCAAGGAGCTGGCCCGGAGGCATCAGGCGGTCCTCGTGGCCC
CCGGGCATCCCCTTCTGGAGGCCATCATTGAGCGGCTTCTTTCCCGGTCCGAAGGGGAGCTGAGGCGCGGGGCACTCTTC
GCCGACCCCGACGGGAAACTCGAGGGCTTCCTCTGGTTTTTGGAGGTGGAGGTCCGCGACGGGCAAAACCAGGTGGCGGG
CAAGCGCCTCTTTGCCGTCTACCAGTCTGAAGCGGGGGAACTCCGCCTCGTTCACCCTTCGGTCCTTTGGGACCTGAAGC
CCCTTTCCCCCGGGGAGGCCTCCTTTGACGGCGGCCTTCTGGACGAGGGGAGGGTGGTGGGCTTCGCCATAGAGCAGGCC
CTCGAGCCCTACCGCCAGGAGCTTTTGGCCTGGCGGGAACGGGACGCCGAGGTCAAGCGCCGCTACGGCCTGCGCTCCTT
GGAGCAGATGCTCCTGGACTCCGAGGCCAAGCTTTTGGAGTACGAGACCCGGCGGGCCCAGGGGGAGAACATCCCCGAGG
CCACCCTCCAGAACGAAAGGCGGCGGAAGGAGGAGCTGGAGGCCCGCAAGAAGAGGCTGGAGGAGGCGATTCGGCGGGAG
CTTAGCCTCACCGCGGCCGCCCCTCGGGTTCTCGGGGTGGCCCGGGTGGTGCCCCTTGTCAAGGGGGAGGCGGCCATGCG
CCCTGACCCCGAGGTGGAGGCCATCGGCATGGAGGTGGCCCTGCGGTACGAGCGGGAGGCGGGGTGGACGCCCGAGGACG
TTTCCCGCGAGAACCTGGGCTACGATATCCGTTCCGTGTCCCCTGAAGGCGCCGTTCGCTACATTGAGGTCAAGGCGCGG
GCCGCCACGGGCCCCGTGGCCCTGACCCCCAACGAGTGGGTGATGGCTCAGCGCCTGGGGGAGGACTACTGGCTCTACAT
CGTGGAGCACGCCGCCACCCGCCCGGTGCTCCACCGGGTACAAAACCCGGCGGCCAAGCTTGCGCCCAAAGAGGTGGTGG
ACGTGGTGCGCTACGTGGTCAACGACTGGAAGAAGGCGGCGGAGAGCAGCTAA

Upstream 100 bases:

>100_bases
GGTTTCCGCCAGATCGGGTGGGGTTTTTGAGTCCTTGGTCATTTGCGGCCGGATCTGGAGGCGAGGGTGGATATACTTCC
CTTCAGGGGAGATGGGCACA

Downstream 100 bases:

>100_bases
TCCAATGGCACCAGAGGAGGGCAACCGATCCAATGACTCCGGAGCTAGTCCGAGAACTAATCGCACGGGGCGAAGCCTTG
ACCCTTGAGTTCAAAGGGGA

Product: hypothetical protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 1110; Mature: 1109

Protein sequence:

>1110_residues
MGFGLDPKDLRPGDVLEGDCFPEPVRVIQIQVWGDLFRLEAVGTRTQGYYDRVLSIQDLGSLRRFRASGGRDFGGAPEAF
FLAVEGHRIRFAQQFDPLFAVNVSQIDPLPHQIEAVYFYILRNPRVRFLLADDPGAGKTIMAGLLLKELKYRGLVQRTLI
VVPGHLKDQWRREMKERFAETFLVVDRGMVEANWGRNVWREHPQVITSMDFAKRDEVLASLAEADWDLVIVDEAHKMTAY
RYGEKTHKTERYRLGELLSRTSQFLLFLTATPHRGDPENFRLFLDLLEPGFFASRELLLESIARKDNPLFLRRLKEDLKD
FEGRRLFPPRKVFTVTYYLSDEEKLLYNAVTSYVEASYNKALAREKRNVAFALLILQRRLASSVRAVRRSLERRRERLAQ
LLEVGRWLAERGEVDEEALEDLEEWERLKREEDLVAQLTAAETREELEREIAQLDELIALARRAERLEIETKLRKLREVM
EDERLQQTGEKLLIFTESRETLEYLVEKLRGWGYSVVSLHGGMDLDARIRAEHEFRERAQVMVSTEAGGEGINLQFCSLM
VNYDIPWNPNRLEQRMGRVHRYGQTKEVHIYNLVALDTREGKVLEALFRKLREIQEALGSDRVFDVVGEVLPGKSLKELI
VEAIANRRTLDEIVCEIEAVPDQEAVRRVREAALEALAVRHIDLTQVLGEERRARENRLVPEYIERFFERACRFLGVPLE
RRGDGLWRVPRVPHELRDLSREFKDRYGEVFPEYRKLAFSKELARRHQAVLVAPGHPLLEAIIERLLSRSEGELRRGALF
ADPDGKLEGFLWFLEVEVRDGQNQVAGKRLFAVYQSEAGELRLVHPSVLWDLKPLSPGEASFDGGLLDEGRVVGFAIEQA
LEPYRQELLAWRERDAEVKRRYGLRSLEQMLLDSEAKLLEYETRRAQGENIPEATLQNERRRKEELEARKKRLEEAIRRE
LSLTAAAPRVLGVARVVPLVKGEAAMRPDPEVEAIGMEVALRYEREAGWTPEDVSRENLGYDIRSVSPEGAVRYIEVKAR
AATGPVALTPNEWVMAQRLGEDYWLYIVEHAATRPVLHRVQNPAAKLAPKEVVDVVRYVVNDWKKAAESS

Sequences:

>Translated_1110_residues
MGFGLDPKDLRPGDVLEGDCFPEPVRVIQIQVWGDLFRLEAVGTRTQGYYDRVLSIQDLGSLRRFRASGGRDFGGAPEAF
FLAVEGHRIRFAQQFDPLFAVNVSQIDPLPHQIEAVYFYILRNPRVRFLLADDPGAGKTIMAGLLLKELKYRGLVQRTLI
VVPGHLKDQWRREMKERFAETFLVVDRGMVEANWGRNVWREHPQVITSMDFAKRDEVLASLAEADWDLVIVDEAHKMTAY
RYGEKTHKTERYRLGELLSRTSQFLLFLTATPHRGDPENFRLFLDLLEPGFFASRELLLESIARKDNPLFLRRLKEDLKD
FEGRRLFPPRKVFTVTYYLSDEEKLLYNAVTSYVEASYNKALAREKRNVAFALLILQRRLASSVRAVRRSLERRRERLAQ
LLEVGRWLAERGEVDEEALEDLEEWERLKREEDLVAQLTAAETREELEREIAQLDELIALARRAERLEIETKLRKLREVM
EDERLQQTGEKLLIFTESRETLEYLVEKLRGWGYSVVSLHGGMDLDARIRAEHEFRERAQVMVSTEAGGEGINLQFCSLM
VNYDIPWNPNRLEQRMGRVHRYGQTKEVHIYNLVALDTREGKVLEALFRKLREIQEALGSDRVFDVVGEVLPGKSLKELI
VEAIANRRTLDEIVCEIEAVPDQEAVRRVREAALEALAVRHIDLTQVLGEERRARENRLVPEYIERFFERACRFLGVPLE
RRGDGLWRVPRVPHELRDLSREFKDRYGEVFPEYRKLAFSKELARRHQAVLVAPGHPLLEAIIERLLSRSEGELRRGALF
ADPDGKLEGFLWFLEVEVRDGQNQVAGKRLFAVYQSEAGELRLVHPSVLWDLKPLSPGEASFDGGLLDEGRVVGFAIEQA
LEPYRQELLAWRERDAEVKRRYGLRSLEQMLLDSEAKLLEYETRRAQGENIPEATLQNERRRKEELEARKKRLEEAIRRE
LSLTAAAPRVLGVARVVPLVKGEAAMRPDPEVEAIGMEVALRYEREAGWTPEDVSRENLGYDIRSVSPEGAVRYIEVKAR
AATGPVALTPNEWVMAQRLGEDYWLYIVEHAATRPVLHRVQNPAAKLAPKEVVDVVRYVVNDWKKAAESS
>Mature_1109_residues
GFGLDPKDLRPGDVLEGDCFPEPVRVIQIQVWGDLFRLEAVGTRTQGYYDRVLSIQDLGSLRRFRASGGRDFGGAPEAFF
LAVEGHRIRFAQQFDPLFAVNVSQIDPLPHQIEAVYFYILRNPRVRFLLADDPGAGKTIMAGLLLKELKYRGLVQRTLIV
VPGHLKDQWRREMKERFAETFLVVDRGMVEANWGRNVWREHPQVITSMDFAKRDEVLASLAEADWDLVIVDEAHKMTAYR
YGEKTHKTERYRLGELLSRTSQFLLFLTATPHRGDPENFRLFLDLLEPGFFASRELLLESIARKDNPLFLRRLKEDLKDF
EGRRLFPPRKVFTVTYYLSDEEKLLYNAVTSYVEASYNKALAREKRNVAFALLILQRRLASSVRAVRRSLERRRERLAQL
LEVGRWLAERGEVDEEALEDLEEWERLKREEDLVAQLTAAETREELEREIAQLDELIALARRAERLEIETKLRKLREVME
DERLQQTGEKLLIFTESRETLEYLVEKLRGWGYSVVSLHGGMDLDARIRAEHEFRERAQVMVSTEAGGEGINLQFCSLMV
NYDIPWNPNRLEQRMGRVHRYGQTKEVHIYNLVALDTREGKVLEALFRKLREIQEALGSDRVFDVVGEVLPGKSLKELIV
EAIANRRTLDEIVCEIEAVPDQEAVRRVREAALEALAVRHIDLTQVLGEERRARENRLVPEYIERFFERACRFLGVPLER
RGDGLWRVPRVPHELRDLSREFKDRYGEVFPEYRKLAFSKELARRHQAVLVAPGHPLLEAIIERLLSRSEGELRRGALFA
DPDGKLEGFLWFLEVEVRDGQNQVAGKRLFAVYQSEAGELRLVHPSVLWDLKPLSPGEASFDGGLLDEGRVVGFAIEQAL
EPYRQELLAWRERDAEVKRRYGLRSLEQMLLDSEAKLLEYETRRAQGENIPEATLQNERRRKEELEARKKRLEEAIRREL
SLTAAAPRVLGVARVVPLVKGEAAMRPDPEVEAIGMEVALRYEREAGWTPEDVSRENLGYDIRSVSPEGAVRYIEVKARA
ATGPVALTPNEWVMAQRLGEDYWLYIVEHAATRPVLHRVQNPAAKLAPKEVVDVVRYVVNDWKKAAESS

Specific function: Transcription Regulator That Activates Transcription By Stimulating RNA Polymerase (Rnap) Recycling In Case Of Stress Conditions Such As Supercoiled DNA Or High Salt Concentrations. Probably Acts By Releasing The Rnap, When It Is Trapped Or Immobilized On

COG id: COG0553

COG function: function code KL; Superfamily II DNA/RNA helicases, SNF2 family

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 helicase C-terminal domain [H]

Homologues:

Organism=Homo sapiens, GI6912622, Length=558, Percent_Identity=25.6272401433692, Blast_Score=116, Evalue=1e-25,
Organism=Homo sapiens, GI190358536, Length=528, Percent_Identity=24.4318181818182, Blast_Score=94, Evalue=6e-19,
Organism=Homo sapiens, GI190358532, Length=528, Percent_Identity=24.4318181818182, Blast_Score=94, Evalue=6e-19,
Organism=Homo sapiens, GI190358534, Length=529, Percent_Identity=24.007561436673, Blast_Score=92, Evalue=2e-18,
Organism=Homo sapiens, GI58219008, Length=540, Percent_Identity=23.5185185185185, Blast_Score=82, Evalue=3e-15,
Organism=Homo sapiens, GI21914927, Length=135, Percent_Identity=35.5555555555556, Blast_Score=80, Evalue=1e-14,
Organism=Homo sapiens, GI38708321, Length=125, Percent_Identity=33.6, Blast_Score=75, Evalue=2e-13,
Organism=Homo sapiens, GI40807471, Length=576, Percent_Identity=25.8680555555556, Blast_Score=74, Evalue=8e-13,
Organism=Homo sapiens, GI118421089, Length=171, Percent_Identity=34.5029239766082, Blast_Score=74, Evalue=9e-13,
Organism=Homo sapiens, GI21071058, Length=154, Percent_Identity=31.1688311688312, Blast_Score=73, Evalue=2e-12,
Organism=Homo sapiens, GI164419749, Length=161, Percent_Identity=30.4347826086957, Blast_Score=72, Evalue=3e-12,
Organism=Homo sapiens, GI146219843, Length=130, Percent_Identity=33.0769230769231, Blast_Score=72, Evalue=4e-12,
Organism=Homo sapiens, GI24308089, Length=133, Percent_Identity=32.3308270676692, Blast_Score=70, Evalue=1e-11,
Organism=Homo sapiens, GI51599156, Length=127, Percent_Identity=32.2834645669291, Blast_Score=69, Evalue=3e-11,
Organism=Escherichia coli, GI1786245, Length=188, Percent_Identity=38.2978723404255, Blast_Score=93, Evalue=8e-20,
Organism=Caenorhabditis elegans, GI193204424, Length=554, Percent_Identity=23.4657039711191, Blast_Score=87, Evalue=6e-17,
Organism=Caenorhabditis elegans, GI71988744, Length=543, Percent_Identity=25.414364640884, Blast_Score=77, Evalue=5e-14,
Organism=Caenorhabditis elegans, GI32563629, Length=132, Percent_Identity=36.3636363636364, Blast_Score=75, Evalue=2e-13,
Organism=Caenorhabditis elegans, GI115534248, Length=196, Percent_Identity=28.5714285714286, Blast_Score=72, Evalue=2e-12,
Organism=Caenorhabditis elegans, GI193203140, Length=161, Percent_Identity=31.055900621118, Blast_Score=72, Evalue=2e-12,
Organism=Caenorhabditis elegans, GI17539642, Length=190, Percent_Identity=29.4736842105263, Blast_Score=71, Evalue=4e-12,
Organism=Caenorhabditis elegans, GI17508659, Length=179, Percent_Identity=28.4916201117318, Blast_Score=70, Evalue=9e-12,
Organism=Caenorhabditis elegans, GI71995707, Length=143, Percent_Identity=32.1678321678322, Blast_Score=69, Evalue=1e-11,
Organism=Caenorhabditis elegans, GI17551114, Length=132, Percent_Identity=32.5757575757576, Blast_Score=69, Evalue=1e-11,
Organism=Caenorhabditis elegans, GI25144179, Length=134, Percent_Identity=31.3432835820896, Blast_Score=69, Evalue=2e-11,
Organism=Saccharomyces cerevisiae, GI6325175, Length=603, Percent_Identity=24.0464344941957, Blast_Score=91, Evalue=1e-18,
Organism=Saccharomyces cerevisiae, GI6319300, Length=545, Percent_Identity=22.9357798165138, Blast_Score=91, Evalue=1e-18,
Organism=Saccharomyces cerevisiae, GI6320541, Length=142, Percent_Identity=33.8028169014084, Blast_Score=79, Evalue=4e-15,
Organism=Saccharomyces cerevisiae, GI6324879, Length=134, Percent_Identity=33.5820895522388, Blast_Score=76, Evalue=3e-14,
Organism=Saccharomyces cerevisiae, GI6321289, Length=132, Percent_Identity=34.8484848484849, Blast_Score=74, Evalue=1e-13,
Organism=Saccharomyces cerevisiae, GI6319722, Length=139, Percent_Identity=32.3741007194245, Blast_Score=73, Evalue=2e-13,
Organism=Saccharomyces cerevisiae, GI6321012, Length=132, Percent_Identity=35.6060606060606, Blast_Score=70, Evalue=2e-12,
Organism=Saccharomyces cerevisiae, GI6324864, Length=163, Percent_Identity=28.8343558282209, Blast_Score=69, Evalue=5e-12,
Organism=Saccharomyces cerevisiae, GI6322065, Length=132, Percent_Identity=28.7878787878788, Blast_Score=66, Evalue=3e-11,
Organism=Drosophila melanogaster, GI24648168, Length=144, Percent_Identity=34.7222222222222, Blast_Score=80, Evalue=7e-15,
Organism=Drosophila melanogaster, GI24653134, Length=146, Percent_Identity=33.5616438356164, Blast_Score=77, Evalue=6e-14,
Organism=Drosophila melanogaster, GI24653132, Length=146, Percent_Identity=33.5616438356164, Blast_Score=77, Evalue=6e-14,
Organism=Drosophila melanogaster, GI17737463, Length=146, Percent_Identity=33.5616438356164, Blast_Score=77, Evalue=6e-14,
Organism=Drosophila melanogaster, GI24666729, Length=171, Percent_Identity=28.6549707602339, Blast_Score=74, Evalue=8e-13,
Organism=Drosophila melanogaster, GI28573600, Length=130, Percent_Identity=33.8461538461538, Blast_Score=72, Evalue=3e-12,
Organism=Drosophila melanogaster, GI24656966, Length=130, Percent_Identity=33.8461538461538, Blast_Score=71, Evalue=4e-12,
Organism=Drosophila melanogaster, GI24656962, Length=130, Percent_Identity=33.8461538461538, Blast_Score=71, Evalue=4e-12,
Organism=Drosophila melanogaster, GI21356675, Length=170, Percent_Identity=30, Blast_Score=70, Evalue=6e-12,
Organism=Drosophila melanogaster, GI24650076, Length=170, Percent_Identity=30, Blast_Score=70, Evalue=6e-12,
Organism=Drosophila melanogaster, GI17137266, Length=132, Percent_Identity=33.3333333333333, Blast_Score=70, Evalue=8e-12,
Organism=Drosophila melanogaster, GI62472261, Length=162, Percent_Identity=30.2469135802469, Blast_Score=70, Evalue=9e-12,
Organism=Drosophila melanogaster, GI281366478, Length=162, Percent_Identity=30.2469135802469, Blast_Score=70, Evalue=9e-12,
Organism=Drosophila melanogaster, GI24667055, Length=162, Percent_Identity=30.2469135802469, Blast_Score=70, Evalue=9e-12,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR014001
- InterPro:   IPR001650
- InterPro:   IPR014021
- InterPro:   IPR000330 [H]

Pfam domain/function: PF00271 Helicase_C; PF00176 SNF2_N [H]

EC number: 3.6.1.- [C]

Molecular weight: Translated: 128210; Mature: 128079

Theoretical pI: Translated: 6.14; Mature: 6.14

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.4 %Cys     (Translated Protein)
1.4 %Met     (Translated Protein)
1.7 %Cys+Met (Translated Protein)
0.4 %Cys     (Mature Protein)
1.3 %Met     (Mature Protein)
1.6 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MGFGLDPKDLRPGDVLEGDCFPEPVRVIQIQVWGDLFRLEAVGTRTQGYYDRVLSIQDLG
CCCCCCCCCCCCCCCCCCCCCCCCEEEEEEEECCCHHHHHHHCCCCCCHHHHHHHHHHHH
SLRRFRASGGRDFGGAPEAFFLAVEGHRIRFAQQFDPLFAVNVSQIDPLPHQIEAVYFYI
HHHHHHHCCCCCCCCCCCEEEEEECCCEEEEHHHCCCEEEEEHHHCCCCCHHHHHHEEEE
LRNPRVRFLLADDPGAGKTIMAGLLLKELKYRGLVQRTLIVVPGHLKDQWRREMKERFAE
ECCCCEEEEEECCCCCCHHHHHHHHHHHHHHHHHHHHHHEEECCCHHHHHHHHHHHHHHH
TFLVVDRGMVEANWGRNVWREHPQVITSMDFAKRDEVLASLAEADWDLVIVDEAHKMTAY
HHHHHHCCCEECCCCHHHHHHCHHHHHHHHHHHHHHHHHHHHHCCCCEEEECCCHHHHHH
RYGEKTHKTERYRLGELLSRTSQFLLFLTATPHRGDPENFRLFLDLLEPGFFASRELLLE
HCCCHHHHHHHHHHHHHHHHHHHEEEEEEECCCCCCCHHHHHHHHHHCCCCHHHHHHHHH
SIARKDNPLFLRRLKEDLKDFEGRRLFPPRKVFTVTYYLSDEEKLLYNAVTSYVEASYNK
HHHCCCCHHHHHHHHHHHHHCCCCCCCCCCEEEEEEEEECCCHHHHHHHHHHHHHHHHHH
ALAREKRNVAFALLILQRRLASSVRAVRRSLERRRERLAQLLEVGRWLAERGEVDEEALE
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHH
DLEEWERLKREEDLVAQLTAAETREELEREIAQLDELIALARRAERLEIETKLRKLREVM
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
EDERLQQTGEKLLIFTESRETLEYLVEKLRGWGYSVVSLHGGMDLDARIRAEHEFRERAQ
HHHHHHHCCCEEEEEECCHHHHHHHHHHHCCCCEEEEEECCCCCCCHHHHHHHHHHHHHH
VMVSTEAGGEGINLQFCSLMVNYDIPWNPNRLEQRMGRVHRYGQTKEVHIYNLVALDTRE
EEEEECCCCCCCCEEEEEEEEECCCCCCCHHHHHHHHHHHHCCCCCEEEEEEEEEEECCC
GKVLEALFRKLREIQEALGSDRVFDVVGEVLPGKSLKELIVEAIANRRTLDEIVCEIEAV
CHHHHHHHHHHHHHHHHHCCCHHHHHHHHHCCCCHHHHHHHHHHHCCCHHHHHHHHHHCC
PDQEAVRRVREAALEALAVRHIDLTQVLGEERRARENRLVPEYIERFFERACRFLGVPLE
CCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHCCCHH
RRGDGLWRVPRVPHELRDLSREFKDRYGEVFPEYRKLAFSKELARRHQAVLVAPGHPLLE
HCCCCCEECCCCCHHHHHHHHHHHHHHHHHCHHHHHHHHHHHHHHHCCEEEECCCCHHHH
AIIERLLSRSEGELRRGALFADPDGKLEGFLWFLEVEVRDGQNQVAGKRLFAVYQSEAGE
HHHHHHHCCCCCCHHCCCEEECCCCCCCEEEEEEEEEEECCCCHHHHHHHHHHHHCCCCC
LRLVHPSVLWDLKPLSPGEASFDGGLLDEGRVVGFAIEQALEPYRQELLAWRERDAEVKR
EEEECHHHHEECCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHCCHHHHH
RYGLRSLEQMLLDSEAKLLEYETRRAQGENIPEATLQNERRRKEELEARKKRLEEAIRRE
HHCHHHHHHHHHCCHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHH
LSLTAAAPRVLGVARVVPLVKGEAAMRPDPEVEAIGMEVALRYEREAGWTPEDVSRENLG
HHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHEEEHHCCCCCCCCCCHHHCC
YDIRSVSPEGAVRYIEVKARAATGPVALTPNEWVMAQRLGEDYWLYIVEHAATRPVLHRV
CCCCCCCCCCCEEEEEEEEECCCCCEEECCCHHHHHHHCCCCCEEEEEHHHHHHHHHHHH
QNPAAKLAPKEVVDVVRYVVNDWKKAAESS
CCCHHHCCHHHHHHHHHHHHHHHHHHHCCC
>Mature Secondary Structure 
GFGLDPKDLRPGDVLEGDCFPEPVRVIQIQVWGDLFRLEAVGTRTQGYYDRVLSIQDLG
CCCCCCCCCCCCCCCCCCCCCCCEEEEEEEECCCHHHHHHHCCCCCCHHHHHHHHHHHH
SLRRFRASGGRDFGGAPEAFFLAVEGHRIRFAQQFDPLFAVNVSQIDPLPHQIEAVYFYI
HHHHHHHCCCCCCCCCCCEEEEEECCCEEEEHHHCCCEEEEEHHHCCCCCHHHHHHEEEE
LRNPRVRFLLADDPGAGKTIMAGLLLKELKYRGLVQRTLIVVPGHLKDQWRREMKERFAE
ECCCCEEEEEECCCCCCHHHHHHHHHHHHHHHHHHHHHHEEECCCHHHHHHHHHHHHHHH
TFLVVDRGMVEANWGRNVWREHPQVITSMDFAKRDEVLASLAEADWDLVIVDEAHKMTAY
HHHHHHCCCEECCCCHHHHHHCHHHHHHHHHHHHHHHHHHHHHCCCCEEEECCCHHHHHH
RYGEKTHKTERYRLGELLSRTSQFLLFLTATPHRGDPENFRLFLDLLEPGFFASRELLLE
HCCCHHHHHHHHHHHHHHHHHHHEEEEEEECCCCCCCHHHHHHHHHHCCCCHHHHHHHHH
SIARKDNPLFLRRLKEDLKDFEGRRLFPPRKVFTVTYYLSDEEKLLYNAVTSYVEASYNK
HHHCCCCHHHHHHHHHHHHHCCCCCCCCCCEEEEEEEEECCCHHHHHHHHHHHHHHHHHH
ALAREKRNVAFALLILQRRLASSVRAVRRSLERRRERLAQLLEVGRWLAERGEVDEEALE
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHH
DLEEWERLKREEDLVAQLTAAETREELEREIAQLDELIALARRAERLEIETKLRKLREVM
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
EDERLQQTGEKLLIFTESRETLEYLVEKLRGWGYSVVSLHGGMDLDARIRAEHEFRERAQ
HHHHHHHCCCEEEEEECCHHHHHHHHHHHCCCCEEEEEECCCCCCCHHHHHHHHHHHHHH
VMVSTEAGGEGINLQFCSLMVNYDIPWNPNRLEQRMGRVHRYGQTKEVHIYNLVALDTRE
EEEEECCCCCCCCEEEEEEEEECCCCCCCHHHHHHHHHHHHCCCCCEEEEEEEEEEECCC
GKVLEALFRKLREIQEALGSDRVFDVVGEVLPGKSLKELIVEAIANRRTLDEIVCEIEAV
CHHHHHHHHHHHHHHHHHCCCHHHHHHHHHCCCCHHHHHHHHHHHCCCHHHHHHHHHHCC
PDQEAVRRVREAALEALAVRHIDLTQVLGEERRARENRLVPEYIERFFERACRFLGVPLE
CCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHCCCHH
RRGDGLWRVPRVPHELRDLSREFKDRYGEVFPEYRKLAFSKELARRHQAVLVAPGHPLLE
HCCCCCEECCCCCHHHHHHHHHHHHHHHHHCHHHHHHHHHHHHHHHCCEEEECCCCHHHH
AIIERLLSRSEGELRRGALFADPDGKLEGFLWFLEVEVRDGQNQVAGKRLFAVYQSEAGE
HHHHHHHCCCCCCHHCCCEEECCCCCCCEEEEEEEEEEECCCCHHHHHHHHHHHHCCCCC
LRLVHPSVLWDLKPLSPGEASFDGGLLDEGRVVGFAIEQALEPYRQELLAWRERDAEVKR
EEEECHHHHEECCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHCCHHHHH
RYGLRSLEQMLLDSEAKLLEYETRRAQGENIPEATLQNERRRKEELEARKKRLEEAIRRE
HHCHHHHHHHHHCCHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHH
LSLTAAAPRVLGVARVVPLVKGEAAMRPDPEVEAIGMEVALRYEREAGWTPEDVSRENLG
HHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHEEEHHCCCCCCCCCCHHHCC
YDIRSVSPEGAVRYIEVKARAATGPVALTPNEWVMAQRLGEDYWLYIVEHAATRPVLHRV
CCCCCCCCCCCEEEEEEEEECCCCCEEECCCHHHHHHHCCCCCEEEEEHHHHHHHHHHHH
QNPAAKLAPKEVVDVVRYVVNDWKKAAESS
CCCHHHCCHHHHHHHHHHHHHHHHHHHCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: DNA [C]

Specific reaction: Protein + DNA = Protein-DNA [C]

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 8969508; 9384377 [H]