Definition Chloroflexus sp. Y-400-fl chromosome, complete genome.
Accession NC_012032
Length 5,268,950

Click here to switch to the map view.

The map label for this gene is yqhH [H]

Identifier: 222526160

GI number: 222526160

Start: 3604820

End: 3608389

Strand: Direct

Name: yqhH [H]

Synonym: Chy400_2917

Alternate gene names: 222526160

Gene position: 3604820-3608389 (Clockwise)

Preceding gene: 222526158

Following gene: 222526161

Centisome position: 68.42

GC content: 61.2

Gene sequence:

>3570_bases
TTGCTGGCGCTCGATGATTTGAAACCTGGGGTGACGATTCGCGGTATTCTGCCCGATACGCCGGTGACGGTGGTGAGTGT
ACAGTGGTACGGGACGGAGGCGTTGACGCTGGTGTATCGCGATCCCAGCGGGAAGGTGGCCGATCAGTTGCTGTATCGCA
GTGATGAAGCGCGCCTGGAGCTGGTTGAGCAGGGGCGACCCTGGAGTTTTGATGGCGATGGATCGCTCTTTCGGCTGGTC
GCTGAGGCACATCGGATTCGGCTGGCTTATCTGTTCGATCCGCTGCTGGCCGTGCATACGTCGCTGGTGGAACCGTTGCC
GCATCAGATTACCGCTGTCTATGAGGCGATGTTGCCGCGCCAGCCGTTGCGCTTTTTGTTGGCCGATGACCCCGGCGCCG
GGAAGACGATTATGGCCGGGTTGTTGATGAAGGAGTTGATCGCCCGCGGTGATTTGCAACGCTGTCTGGTTATCTGTCCC
GGTAATCTGGTTGAGCAGTGGCAGGATGAACTCGACCGCCGGTTCCATTTGCCGTTCGAGATTCTGACCAACGATGGTCT
GGAAGCGGCCCGCACCGGGAACTGGTTTTTGGAACATCCGCTGGTGATCGCCCGCCTCGATAAGCTGGCCCGCGATGAAC
AGGCGCAGGCGAAGCTCGCTGCTCCTGATAACCGCTACGATCTGGTGGTGATCGATGAGGCGCATAAGCTGTCGGCCAGC
TTCTTCGGCGGTGAGATTAAGTACACCAAACGCTATCAGCTCGGTCAGCTCGTTTCTCGTCTGACCCGGCATTTTCTGCT
GATGACGGCCACACCGCACAACGGCAAGGAAGCGGATTTTCAGCTCTTTCTTGCGCTGCTTGATGCTGATCGGTTTGAGG
GTCGTTTCCGCGATGGTGTCCATCAGGTTGATGTCTCCGATTTGATGCGGCGGATGACGAAAGAGCATCTGCTGAAGTTT
GATGGGACGCCGCTCTTTCCGGAGCGAATTGCCTACACCGTGCCGTACCGTCTCTCTGCTGAGGAGGCGCGGCTGTACCA
CGACGTGACGACCTATGTGCGCGAGGAATTTAACCGCGCCGATGCATTGCAAAATGACCGCCGATCAGGGACGGTGGGGT
TTGCCCTGACTATTCTGCAGCGGCGACTGGCTTCGTCACCAGAAGCGATTTATCAATCGCTGCGGCGCCGGCGTGAGCGG
TTGGAGCGGCGTCTGCGCGAGCTGGAGCTGGAACAACGTGAGGTGCAGGTCACCAGTTCGATGCCCGATCTCAGTCGGGA
AGATATTGACGAACTCGAAGAGGCGCCTGAGAGTGAGCTGGCACAGATTGAGGAGGATGTGCTCGATCAGGCGACGGCAG
CACGCACGATTGCTGAGTTGCGGCGTGAGATTGATACGTTGAGGGCGCTGGAGGTGCAGGCTGATGCGGTGCGTCGCCAG
GGGGTTGATACCAAGTGGCGCGAGTTGTCGGCGCTGCTCGGTGAGATTTTTACGCCCGCTGCGCTCGCGCCGCAGATCGC
CGAGGCGCATACGCCGTATGATGCCGATGGTGCTCCGAAGCCGAAACCGTCGCCGACGCAGAAGCTGGTTGTCTTTACCG
AGCACCGTGATACGCTAACCTACCTGGAGCGGAAGATCAACGGTTTGTTCGGTCGGCCAGATGCGGTTGTGGTGATCCAC
GGTGGGATGGGGCGCGAGGAGCGCCGGAAGGCGCAGGAGCAGTTTCTGCACGATCCCGCTGTGCGGGTGCTGGTGGCGAC
CGATGCCGCCGGTGAAGGGATTAATCTGCAACGCGCTCATTTGATGGTGAATTACGATCTGCCCTGGAACCCGAACCGGC
TGGAGCAACGCTTTGGCCGGATTCATCGTATCGGGCAGACCGAGGTCTGTTTCCTGTGGAATCTGGTGGCCGATGAGACC
CGCGAAGGCGATGTGTACCGCCGTCTGCTCGATAAGCTGGAAGAGGCGCGGCGGGCGCTCGGTGGCAAGGTCTTCGACGT
GCTCGGTAAGCTCCAGTTCGACGGTCGCCCGCTGCGCGATCTGATGATCGAGGCGATCCGCTACGGTGATCAGCCGGAGG
TGCGCGCCCGGCTGTCGCAGGTAGTTGAAAACGCCGTGGATAAGGAGCGGTTGCAGGCGTTGCTGGAAGAGCGGGCGCTG
GCCCACGATGTGATGGATGTCAGTCGGGTGGCCCGTATCCGGGTAGAGATGGAGCGGGCGGCAGCGCGGCGGCTACAACC
GCATTACATTGAGTCGTTCTTTCTCGCGGCGTTTCGCCGGCTCGGCGGTACGGTGCGCGAACGCGAACCCCGGCGCTACG
AGGTAACTCACGTGCCGGCAGTGGTACGCAATCGCAATCGCCAGATCGGGAGCGGTAATCCGGTGCTCCCGCGCTACGAG
CGCATCTGCTTCGAGAAAGATCTTATCGCCCCGATGGGTCGCCCACTGGCTGCCTTCGTGTGCCCCGGTCATCCGCTGCT
CGATGCTGTGATTGACCTGACGCTCGAACAGCACCGTGATCTGCTCAAGCGTGGTGCGATCCTGGTTGATGAGCGGGATG
TCGGGCGCGAACCACGGGTGCTCTGCATCGTCGAACATGCCATTCAGGACGCCAGCCTGCTGCCGTCGGGCGAGCGGCGG
ACGGTGTCGCGCCGGATGCTGGCGGTCGAAATTGATGCCCACGGTCGTACCCGGCATCTCCAGTATGCGCCGTACCTCGA
CTACCGCCCACTCGCTGCCGACGAACCCGATGCTGCAACCATACTGGCGCACCCTGATGTGGCCTGGGTGACGCATGATC
TGGAGCAGCGGGTGATGCAGGATGTGATTGCGCAGATGGTGCCTGAACACATCCGCGAGGTGCGCGAGCGACGGCTGGCC
TGGATTGCGAAGACGCGGGCTGCCGTGCAGGATCGGCTGACCAAAGAGATTATCTACTGGGATCGTCGCGCCGAGGAATG
GAAACTGGACGAGCAGGCCGGAAAACGGAATGCCCGGCTTAACTGGCAAGAGGCGCGGAAGCGAGCCGACGATCTTGAAA
TCCGGCTCAAACAGCGGATGGATGAGCTTGATCGCGAGTCCCAACTCTCGCCCCTACCGCCCGTGCTGGTTGGTGGGGCG
CTGATTATCCCGCGTGGGCTGCTGGACGCGCTAACCGGTCGGTCATCCACCATCCCATCCCAACCGACGGATACGCAGGC
GATTGCGGCGCGGGCGCGTGCCATTGTGATGGAGATCGAGCGCAGCCTGGGCTACGAGCCATCGGATCGGGAATGGGACC
GGCTCGGCTACGATATTGAAAGCCGCGACCCGCGCACCGGTCGGCTGCGCTTCATTGAAGTCAAGGGGCGCCGGGCCGAC
GCCGATACGATCACGGTGACCCGAAACGAGATTTTGACCGCACTCAATAAACCCGACGACTACATTCTGGCGCTGGTGAG
TTTCCAGCCGGACGACCGGTATCAGGTGCGCTACATCCGCCACCCCTTCCGGCGTGAACCGGATTTCGGCGTGACCAGTG
TCCAGTATCAGGTGACCGAATTGCTCAGCCGGGGAGAGGAACCACAATGA

Upstream 100 bases:

>100_bases
CGGCAGGCACCACGTGGTTTGTAATGCACCGCTAATCATGGTGTGTTACCATTCATAAAAATCAGGAGTGTTTTCTACGT
GATAGGAACGGGGAGAGACG

Downstream 100 bases:

>100_bases
CCAGCATTCATCGTCGCCGTAAGCTGATCGAGGTGGCACTGCCACTGGAGAAAATTAATGCCGAAAGTGCCCGTGAAAAA
TCCATTCGCCACGGCCACCC

Product: helicase domain-containing protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 1189; Mature: 1189

Protein sequence:

>1189_residues
MLALDDLKPGVTIRGILPDTPVTVVSVQWYGTEALTLVYRDPSGKVADQLLYRSDEARLELVEQGRPWSFDGDGSLFRLV
AEAHRIRLAYLFDPLLAVHTSLVEPLPHQITAVYEAMLPRQPLRFLLADDPGAGKTIMAGLLMKELIARGDLQRCLVICP
GNLVEQWQDELDRRFHLPFEILTNDGLEAARTGNWFLEHPLVIARLDKLARDEQAQAKLAAPDNRYDLVVIDEAHKLSAS
FFGGEIKYTKRYQLGQLVSRLTRHFLLMTATPHNGKEADFQLFLALLDADRFEGRFRDGVHQVDVSDLMRRMTKEHLLKF
DGTPLFPERIAYTVPYRLSAEEARLYHDVTTYVREEFNRADALQNDRRSGTVGFALTILQRRLASSPEAIYQSLRRRRER
LERRLRELELEQREVQVTSSMPDLSREDIDELEEAPESELAQIEEDVLDQATAARTIAELRREIDTLRALEVQADAVRRQ
GVDTKWRELSALLGEIFTPAALAPQIAEAHTPYDADGAPKPKPSPTQKLVVFTEHRDTLTYLERKINGLFGRPDAVVVIH
GGMGREERRKAQEQFLHDPAVRVLVATDAAGEGINLQRAHLMVNYDLPWNPNRLEQRFGRIHRIGQTEVCFLWNLVADET
REGDVYRRLLDKLEEARRALGGKVFDVLGKLQFDGRPLRDLMIEAIRYGDQPEVRARLSQVVENAVDKERLQALLEERAL
AHDVMDVSRVARIRVEMERAAARRLQPHYIESFFLAAFRRLGGTVREREPRRYEVTHVPAVVRNRNRQIGSGNPVLPRYE
RICFEKDLIAPMGRPLAAFVCPGHPLLDAVIDLTLEQHRDLLKRGAILVDERDVGREPRVLCIVEHAIQDASLLPSGERR
TVSRRMLAVEIDAHGRTRHLQYAPYLDYRPLAADEPDAATILAHPDVAWVTHDLEQRVMQDVIAQMVPEHIREVRERRLA
WIAKTRAAVQDRLTKEIIYWDRRAEEWKLDEQAGKRNARLNWQEARKRADDLEIRLKQRMDELDRESQLSPLPPVLVGGA
LIIPRGLLDALTGRSSTIPSQPTDTQAIAARARAIVMEIERSLGYEPSDREWDRLGYDIESRDPRTGRLRFIEVKGRRAD
ADTITVTRNEILTALNKPDDYILALVSFQPDDRYQVRYIRHPFRREPDFGVTSVQYQVTELLSRGEEPQ

Sequences:

>Translated_1189_residues
MLALDDLKPGVTIRGILPDTPVTVVSVQWYGTEALTLVYRDPSGKVADQLLYRSDEARLELVEQGRPWSFDGDGSLFRLV
AEAHRIRLAYLFDPLLAVHTSLVEPLPHQITAVYEAMLPRQPLRFLLADDPGAGKTIMAGLLMKELIARGDLQRCLVICP
GNLVEQWQDELDRRFHLPFEILTNDGLEAARTGNWFLEHPLVIARLDKLARDEQAQAKLAAPDNRYDLVVIDEAHKLSAS
FFGGEIKYTKRYQLGQLVSRLTRHFLLMTATPHNGKEADFQLFLALLDADRFEGRFRDGVHQVDVSDLMRRMTKEHLLKF
DGTPLFPERIAYTVPYRLSAEEARLYHDVTTYVREEFNRADALQNDRRSGTVGFALTILQRRLASSPEAIYQSLRRRRER
LERRLRELELEQREVQVTSSMPDLSREDIDELEEAPESELAQIEEDVLDQATAARTIAELRREIDTLRALEVQADAVRRQ
GVDTKWRELSALLGEIFTPAALAPQIAEAHTPYDADGAPKPKPSPTQKLVVFTEHRDTLTYLERKINGLFGRPDAVVVIH
GGMGREERRKAQEQFLHDPAVRVLVATDAAGEGINLQRAHLMVNYDLPWNPNRLEQRFGRIHRIGQTEVCFLWNLVADET
REGDVYRRLLDKLEEARRALGGKVFDVLGKLQFDGRPLRDLMIEAIRYGDQPEVRARLSQVVENAVDKERLQALLEERAL
AHDVMDVSRVARIRVEMERAAARRLQPHYIESFFLAAFRRLGGTVREREPRRYEVTHVPAVVRNRNRQIGSGNPVLPRYE
RICFEKDLIAPMGRPLAAFVCPGHPLLDAVIDLTLEQHRDLLKRGAILVDERDVGREPRVLCIVEHAIQDASLLPSGERR
TVSRRMLAVEIDAHGRTRHLQYAPYLDYRPLAADEPDAATILAHPDVAWVTHDLEQRVMQDVIAQMVPEHIREVRERRLA
WIAKTRAAVQDRLTKEIIYWDRRAEEWKLDEQAGKRNARLNWQEARKRADDLEIRLKQRMDELDRESQLSPLPPVLVGGA
LIIPRGLLDALTGRSSTIPSQPTDTQAIAARARAIVMEIERSLGYEPSDREWDRLGYDIESRDPRTGRLRFIEVKGRRAD
ADTITVTRNEILTALNKPDDYILALVSFQPDDRYQVRYIRHPFRREPDFGVTSVQYQVTELLSRGEEPQ
>Mature_1189_residues
MLALDDLKPGVTIRGILPDTPVTVVSVQWYGTEALTLVYRDPSGKVADQLLYRSDEARLELVEQGRPWSFDGDGSLFRLV
AEAHRIRLAYLFDPLLAVHTSLVEPLPHQITAVYEAMLPRQPLRFLLADDPGAGKTIMAGLLMKELIARGDLQRCLVICP
GNLVEQWQDELDRRFHLPFEILTNDGLEAARTGNWFLEHPLVIARLDKLARDEQAQAKLAAPDNRYDLVVIDEAHKLSAS
FFGGEIKYTKRYQLGQLVSRLTRHFLLMTATPHNGKEADFQLFLALLDADRFEGRFRDGVHQVDVSDLMRRMTKEHLLKF
DGTPLFPERIAYTVPYRLSAEEARLYHDVTTYVREEFNRADALQNDRRSGTVGFALTILQRRLASSPEAIYQSLRRRRER
LERRLRELELEQREVQVTSSMPDLSREDIDELEEAPESELAQIEEDVLDQATAARTIAELRREIDTLRALEVQADAVRRQ
GVDTKWRELSALLGEIFTPAALAPQIAEAHTPYDADGAPKPKPSPTQKLVVFTEHRDTLTYLERKINGLFGRPDAVVVIH
GGMGREERRKAQEQFLHDPAVRVLVATDAAGEGINLQRAHLMVNYDLPWNPNRLEQRFGRIHRIGQTEVCFLWNLVADET
REGDVYRRLLDKLEEARRALGGKVFDVLGKLQFDGRPLRDLMIEAIRYGDQPEVRARLSQVVENAVDKERLQALLEERAL
AHDVMDVSRVARIRVEMERAAARRLQPHYIESFFLAAFRRLGGTVREREPRRYEVTHVPAVVRNRNRQIGSGNPVLPRYE
RICFEKDLIAPMGRPLAAFVCPGHPLLDAVIDLTLEQHRDLLKRGAILVDERDVGREPRVLCIVEHAIQDASLLPSGERR
TVSRRMLAVEIDAHGRTRHLQYAPYLDYRPLAADEPDAATILAHPDVAWVTHDLEQRVMQDVIAQMVPEHIREVRERRLA
WIAKTRAAVQDRLTKEIIYWDRRAEEWKLDEQAGKRNARLNWQEARKRADDLEIRLKQRMDELDRESQLSPLPPVLVGGA
LIIPRGLLDALTGRSSTIPSQPTDTQAIAARARAIVMEIERSLGYEPSDREWDRLGYDIESRDPRTGRLRFIEVKGRRAD
ADTITVTRNEILTALNKPDDYILALVSFQPDDRYQVRYIRHPFRREPDFGVTSVQYQVTELLSRGEEPQ

Specific function: Transcription Regulator That Activates Transcription By Stimulating RNA Polymerase (Rnap) Recycling In Case Of Stress Conditions Such As Supercoiled DNA Or High Salt Concentrations. Probably Acts By Releasing The Rnap, When It Is Trapped Or Immobilized On

COG id: COG0553

COG function: function code KL; Superfamily II DNA/RNA helicases, SNF2 family

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 helicase C-terminal domain [H]

Homologues:

Organism=Escherichia coli, GI1786245, Length=196, Percent_Identity=36.2244897959184, Blast_Score=87, Evalue=6e-18,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR014001
- InterPro:   IPR001650
- InterPro:   IPR014021
- InterPro:   IPR000330 [H]

Pfam domain/function: PF00271 Helicase_C; PF00176 SNF2_N [H]

EC number: 3.6.1.- [C]

Molecular weight: Translated: 136318; Mature: 136318

Theoretical pI: Translated: 6.45; Mature: 6.45

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.5 %Cys     (Translated Protein)
1.6 %Met     (Translated Protein)
2.1 %Cys+Met (Translated Protein)
0.5 %Cys     (Mature Protein)
1.6 %Met     (Mature Protein)
2.1 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MLALDDLKPGVTIRGILPDTPVTVVSVQWYGTEALTLVYRDPSGKVADQLLYRSDEARLE
CCCCCCCCCCCEEEECCCCCCEEEEEEEEECCEEEEEEEECCCCHHHHHHHHCCCHHHHH
LVEQGRPWSFDGDGSLFRLVAEAHRIRLAYLFDPLLAVHTSLVEPLPHQITAVYEAMLPR
HHHCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHCCC
QPLRFLLADDPGAGKTIMAGLLMKELIARGDLQRCLVICPGNLVEQWQDELDRRFHLPFE
CCCEEEEECCCCCCHHHHHHHHHHHHHHCCCCCEEEEECCCHHHHHHHHHHHHEECCCHH
ILTNDGLEAARTGNWFLEHPLVIARLDKLARDEQAQAKLAAPDNRYDLVVIDEAHKLSAS
EECCCCCCHHHCCCCHHHCCHHHHHHHHHHCCHHHHHEECCCCCCEEEEEECCCHHHHHH
FFGGEIKYTKRYQLGQLVSRLTRHFLLMTATPHNGKEADFQLFLALLDADRFEGRFRDGV
HCCCEEEEEHHHHHHHHHHHHHHHEEEEEECCCCCCCHHHHHHHHHHHHHHHCCHHHCCC
HQVDVSDLMRRMTKEHLLKFDGTPLFPERIAYTVPYRLSAEEARLYHDVTTYVREEFNRA
CEECHHHHHHHHHHHHHHHCCCCCCCHHHHEEECCCEECHHHHHHHHHHHHHHHHHHHHH
DALQNDRRSGTVGFALTILQRRLASSPEAIYQSLRRRRERLERRLRELELEQREVQVTSS
HHHHCCCCCCCHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCC
MPDLSREDIDELEEAPESELAQIEEDVLDQATAARTIAELRREIDTLRALEVQADAVRRQ
CCCCCHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHC
GVDTKWRELSALLGEIFTPAALAPQIAEAHTPYDADGAPKPKPSPTQKLVVFTEHRDTLT
CCCHHHHHHHHHHHHHHCCHHHCHHHHHCCCCCCCCCCCCCCCCCCCEEEEEECCCHHHH
YLERKINGLFGRPDAVVVIHGGMGREERRKAQEQFLHDPAVRVLVATDAAGEGINLQRAH
HHHHHHHCCCCCCCEEEEEECCCCHHHHHHHHHHHHCCCCEEEEEEECCCCCCCCEEEEE
LMVNYDLPWNPNRLEQRFGRIHRIGQTEVCFLWNLVADETREGDVYRRLLDKLEEARRAL
EEEEECCCCCCHHHHHHHHHHHCCCCCHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHH
GGKVFDVLGKLQFDGRPLRDLMIEAIRYGDQPEVRARLSQVVENAVDKERLQALLEERAL
CCHHHHHHHHHCCCCCCHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
AHDVMDVSRVARIRVEMERAAARRLQPHYIESFFLAAFRRLGGTVREREPRRYEVTHVPA
HHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHCCCHHCCCCCCEEEEECCH
VVRNRNRQIGSGNPVLPRYERICFEKDLIAPMGRPLAAFVCPGHPLLDAVIDLTLEQHRD
HHHCCCCCCCCCCCCCHHHHHHHHHHHHHHCCCCCCEEEECCCCHHHHHHHHHHHHHHHH
LLKRGAILVDERDVGREPRVLCIVEHAIQDASLLPSGERRTVSRRMLAVEIDAHGRTRHL
HHHCCCEEEECCCCCCCCCEEEEEHHHHCCHHCCCCCCHHHHHHEEEEEEECCCCCEEEE
QYAPYLDYRPLAADEPDAATILAHPDVAWVTHDLEQRVMQDVIAQMVPEHIREVRERRLA
EECCCCCCCCCCCCCCCCEEEEECCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
WIAKTRAAVQDRLTKEIIYWDRRAEEWKLDEQAGKRNARLNWQEARKRADDLEIRLKQRM
HHHHHHHHHHHHHHHHHHHHCCCCHHCCCCHHHCCCCCCCCHHHHHCCHHHHHHHHHHHH
DELDRESQLSPLPPVLVGGALIIPRGLLDALTGRSSTIPSQPTDTQAIAARARAIVMEIE
HHHHHHCCCCCCCHHHHCCHHHHHHHHHHHHCCCCCCCCCCCCCHHHHHHHHHHHHHHHH
RSLGYEPSDREWDRLGYDIESRDPRTGRLRFIEVKGRRADADTITVTRNEILTALNKPDD
HHCCCCCCCCCHHHCCCCCCCCCCCCCCEEEEEEECCCCCCCEEEEEHHHHHHHHCCCCC
YILALVSFQPDDRYQVRYIRHPFRREPDFGVTSVQYQVTELLSRGEEPQ
EEEEEEEECCCCCHHHHHHHCCCCCCCCCCCCHHHHHHHHHHHCCCCCC
>Mature Secondary Structure
MLALDDLKPGVTIRGILPDTPVTVVSVQWYGTEALTLVYRDPSGKVADQLLYRSDEARLE
CCCCCCCCCCCEEEECCCCCCEEEEEEEEECCEEEEEEEECCCCHHHHHHHHCCCHHHHH
LVEQGRPWSFDGDGSLFRLVAEAHRIRLAYLFDPLLAVHTSLVEPLPHQITAVYEAMLPR
HHHCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHCCC
QPLRFLLADDPGAGKTIMAGLLMKELIARGDLQRCLVICPGNLVEQWQDELDRRFHLPFE
CCCEEEEECCCCCCHHHHHHHHHHHHHHCCCCCEEEEECCCHHHHHHHHHHHHEECCCHH
ILTNDGLEAARTGNWFLEHPLVIARLDKLARDEQAQAKLAAPDNRYDLVVIDEAHKLSAS
EECCCCCCHHHCCCCHHHCCHHHHHHHHHHCCHHHHHEECCCCCCEEEEEECCCHHHHHH
FFGGEIKYTKRYQLGQLVSRLTRHFLLMTATPHNGKEADFQLFLALLDADRFEGRFRDGV
HCCCEEEEEHHHHHHHHHHHHHHHEEEEEECCCCCCCHHHHHHHHHHHHHHHCCHHHCCC
HQVDVSDLMRRMTKEHLLKFDGTPLFPERIAYTVPYRLSAEEARLYHDVTTYVREEFNRA
CEECHHHHHHHHHHHHHHHCCCCCCCHHHHEEECCCEECHHHHHHHHHHHHHHHHHHHHH
DALQNDRRSGTVGFALTILQRRLASSPEAIYQSLRRRRERLERRLRELELEQREVQVTSS
HHHHCCCCCCCHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCC
MPDLSREDIDELEEAPESELAQIEEDVLDQATAARTIAELRREIDTLRALEVQADAVRRQ
CCCCCHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHC
GVDTKWRELSALLGEIFTPAALAPQIAEAHTPYDADGAPKPKPSPTQKLVVFTEHRDTLT
CCCHHHHHHHHHHHHHHCCHHHCHHHHHCCCCCCCCCCCCCCCCCCCEEEEEECCCHHHH
YLERKINGLFGRPDAVVVIHGGMGREERRKAQEQFLHDPAVRVLVATDAAGEGINLQRAH
HHHHHHHCCCCCCCEEEEEECCCCHHHHHHHHHHHHCCCCEEEEEEECCCCCCCCEEEEE
LMVNYDLPWNPNRLEQRFGRIHRIGQTEVCFLWNLVADETREGDVYRRLLDKLEEARRAL
EEEEECCCCCCHHHHHHHHHHHCCCCCHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHH
GGKVFDVLGKLQFDGRPLRDLMIEAIRYGDQPEVRARLSQVVENAVDKERLQALLEERAL
CCHHHHHHHHHCCCCCCHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
AHDVMDVSRVARIRVEMERAAARRLQPHYIESFFLAAFRRLGGTVREREPRRYEVTHVPA
HHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHCCCHHCCCCCCEEEEECCH
VVRNRNRQIGSGNPVLPRYERICFEKDLIAPMGRPLAAFVCPGHPLLDAVIDLTLEQHRD
HHHCCCCCCCCCCCCCHHHHHHHHHHHHHHCCCCCCEEEECCCCHHHHHHHHHHHHHHHH
LLKRGAILVDERDVGREPRVLCIVEHAIQDASLLPSGERRTVSRRMLAVEIDAHGRTRHL
HHHCCCEEEECCCCCCCCCEEEEEHHHHCCHHCCCCCCHHHHHHEEEEEEECCCCCEEEE
QYAPYLDYRPLAADEPDAATILAHPDVAWVTHDLEQRVMQDVIAQMVPEHIREVRERRLA
EECCCCCCCCCCCCCCCCEEEEECCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
WIAKTRAAVQDRLTKEIIYWDRRAEEWKLDEQAGKRNARLNWQEARKRADDLEIRLKQRM
HHHHHHHHHHHHHHHHHHHHCCCCHHCCCCHHHCCCCCCCCHHHHHCCHHHHHHHHHHHH
DELDRESQLSPLPPVLVGGALIIPRGLLDALTGRSSTIPSQPTDTQAIAARARAIVMEIE
HHHHHHCCCCCCCHHHHCCHHHHHHHHHHHHCCCCCCCCCCCCCHHHHHHHHHHHHHHHH
RSLGYEPSDREWDRLGYDIESRDPRTGRLRFIEVKGRRADADTITVTRNEILTALNKPDD
HHCCCCCCCCCHHHCCCCCCCCCCCCCCEEEEEEECCCCCCCEEEEEHHHHHHHHCCCCC
YILALVSFQPDDRYQVRYIRHPFRREPDFGVTSVQYQVTELLSRGEEPQ
EEEEEEEECCCCCHHHHHHHCCCCCCCCCCCCHHHHHHHHHHHCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: DNA [C]

Specific reaction: Protein + DNA = Protein-DNA [C]

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 8969508; 9384377 [H]