Definition Moorella thermoacetica ATCC 39073, complete genome.
Accession NC_007644
Length 2,628,784

Click here to switch to the map view.

The map label for this gene is yqhH [H]

Identifier: 83590243

GI number: 83590243

Start: 1443520

End: 1444371

Strand: Reverse

Name: yqhH [H]

Synonym: Moth_1396

Alternate gene names: 83590243

Gene position: 1444371-1443520 (Counterclockwise)

Preceding gene: 83590245

Following gene: 83590242

Centisome position: 54.94

GC content: 50.82

Gene sequence:

>852_bases
ATGACCGGCTTATTTATAAAGGAACTTCTCATCCGCGGCGACTTATGCCGCTGTCTGATCGTCTGCCCTGGCAACCTGGT
AGAACAGTGGCAGGACGAGCTTGAGCGCAAGTTCTCTTTGCCCTTTGAGATCCTGACCAACGACCGGATTGAGGCTGCCC
GGACAGGGAATGTTTTCAAGGAATTACCCCTCTGCATCGCTCGCCTGGATAAGCTGGCCCGTGATGAAGACCTGCAGTTT
AAACTCCAGCAAAGCGACTGGGACCTGATAGTTGTTGATGAAGCCCATAAGATGTCCGCCAGCTTTTTTGGTGGTGAAGT
TAAATATACCAAACGATACCGGTTAGGGCAGTTATTATCGCGGATTACACGCCACTTCCTCCTGCTTACGGCTACGCCCC
ATAATGGTAAAGAAGAGGATTTCCAGCTATTTATGGCTCTCCTTGATGGGGACCGGTTTGAAGGCAGGTTCCGGGATGGG
GTCCATGCGGTGGACACATCCGACCTTATGCGTCGTATGGTTAAAGAAGAGTTACTTAAGTTTGACGGCAGGCCCCTGTT
CCCGGAACGGATAGCTTATACAGTAAATTATACCCTTTCTGATATGGAGGCTTATCTCTATAAAGAAGTTACCGATTACG
TCCGGGAAGAATTTAACCGCTCCGATGCCCTGGAGAATGAGGGACGCAAGGGTACCGTCGGCTTTGCCCTGACCATTCTG
CAGCGGCGCCTGGCCTCGTCACCGGAGGCGATCTATCAGTCATTAAAGCGGAGGCGTGAACGTTTAGAGAAACGCCTGCA
GGAAGAGGAGTTGCTTAAAAGGGGCGCCACTATCACATTAAAAGAAAGCTGA

Upstream 100 bases:

>100_bases
CCCATATGATACCACATTCTGTAAGAAAGGCCAATCCTACTTTTTATACCCTGTCTTTTTTGTCTAAATTGATCGGTTAA
ATTAGGTCTTACCCCGCATT

Downstream 100 bases:

>100_bases
TCGAAGTGGCCCTGCCCCTGGAGGCCATTAATAAAGAGTCCGCCCGGGAAAAGTCTATCCGTCACGGCCATCCCTCAACG
TTACATTTATGGTGGTCGCG

Product: SNF2-related

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 283; Mature: 282

Protein sequence:

>283_residues
MTGLFIKELLIRGDLCRCLIVCPGNLVEQWQDELERKFSLPFEILTNDRIEAARTGNVFKELPLCIARLDKLARDEDLQF
KLQQSDWDLIVVDEAHKMSASFFGGEVKYTKRYRLGQLLSRITRHFLLLTATPHNGKEEDFQLFMALLDGDRFEGRFRDG
VHAVDTSDLMRRMVKEELLKFDGRPLFPERIAYTVNYTLSDMEAYLYKEVTDYVREEFNRSDALENEGRKGTVGFALTIL
QRRLASSPEAIYQSLKRRRERLEKRLQEEELLKRGATITLKES

Sequences:

>Translated_283_residues
MTGLFIKELLIRGDLCRCLIVCPGNLVEQWQDELERKFSLPFEILTNDRIEAARTGNVFKELPLCIARLDKLARDEDLQF
KLQQSDWDLIVVDEAHKMSASFFGGEVKYTKRYRLGQLLSRITRHFLLLTATPHNGKEEDFQLFMALLDGDRFEGRFRDG
VHAVDTSDLMRRMVKEELLKFDGRPLFPERIAYTVNYTLSDMEAYLYKEVTDYVREEFNRSDALENEGRKGTVGFALTIL
QRRLASSPEAIYQSLKRRRERLEKRLQEEELLKRGATITLKES
>Mature_282_residues
TGLFIKELLIRGDLCRCLIVCPGNLVEQWQDELERKFSLPFEILTNDRIEAARTGNVFKELPLCIARLDKLARDEDLQFK
LQQSDWDLIVVDEAHKMSASFFGGEVKYTKRYRLGQLLSRITRHFLLLTATPHNGKEEDFQLFMALLDGDRFEGRFRDGV
HAVDTSDLMRRMVKEELLKFDGRPLFPERIAYTVNYTLSDMEAYLYKEVTDYVREEFNRSDALENEGRKGTVGFALTILQ
RRLASSPEAIYQSLKRRRERLEKRLQEEELLKRGATITLKES

Specific function: Transcription Regulator That Activates Transcription By Stimulating RNA Polymerase (Rnap) Recycling In Case Of Stress Conditions Such As Supercoiled DNA Or High Salt Concentrations. Probably Acts By Releasing The Rnap, When It Is Trapped Or Immobilized On

COG id: COG0553

COG function: function code KL; Superfamily II DNA/RNA helicases, SNF2 family

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 helicase C-terminal domain [H]

Homologues:

Organism=Escherichia coli, GI1786245, Length=154, Percent_Identity=33.1168831168831, Blast_Score=70, Evalue=2e-13,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR014001
- InterPro:   IPR001650
- InterPro:   IPR014021
- InterPro:   IPR000330 [H]

Pfam domain/function: PF00271 Helicase_C; PF00176 SNF2_N [H]

EC number: 3.6.1.- [C]

Molecular weight: Translated: 33096; Mature: 32965

Theoretical pI: Translated: 6.54; Mature: 6.54

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.4 %Cys     (Translated Protein)
2.1 %Met     (Translated Protein)
3.5 %Cys+Met (Translated Protein)
1.4 %Cys     (Mature Protein)
1.8 %Met     (Mature Protein)
3.2 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MTGLFIKELLIRGDLCRCLIVCPGNLVEQWQDELERKFSLPFEILTNDRIEAARTGNVFK
CCHHHHHHHHHHCCHHHEEEECCCHHHHHHHHHHHHHHCCCHHHHCCCCHHHHHCCHHHH
ELPLCIARLDKLARDEDLQFKLQQSDWDLIVVDEAHKMSASFFGGEVKYTKRYRLGQLLS
HHHHHHHHHHHHCCCCCCEEEEECCCCCEEEECCCHHHHHHHCCCCCHHHHHHHHHHHHH
RITRHFLLLTATPHNGKEEDFQLFMALLDGDRFEGRFRDGVHAVDTSDLMRRMVKEELLK
HHHHHEEEEEECCCCCCHHHHHHHHHHHCCCCCCCHHHCCCCCCCHHHHHHHHHHHHHHH
FDGRPLFPERIAYTVNYTLSDMEAYLYKEVTDYVREEFNRSDALENEGRKGTVGFALTIL
CCCCCCCHHHHEEEEEEHHHHHHHHHHHHHHHHHHHHHCHHHHHHCCCCCCHHHHHHHHH
QRRLASSPEAIYQSLKRRRERLEKRLQEEELLKRGATITLKES
HHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEECC
>Mature Secondary Structure 
TGLFIKELLIRGDLCRCLIVCPGNLVEQWQDELERKFSLPFEILTNDRIEAARTGNVFK
CHHHHHHHHHHCCHHHEEEECCCHHHHHHHHHHHHHHCCCHHHHCCCCHHHHHCCHHHH
ELPLCIARLDKLARDEDLQFKLQQSDWDLIVVDEAHKMSASFFGGEVKYTKRYRLGQLLS
HHHHHHHHHHHHCCCCCCEEEEECCCCCEEEECCCHHHHHHHCCCCCHHHHHHHHHHHHH
RITRHFLLLTATPHNGKEEDFQLFMALLDGDRFEGRFRDGVHAVDTSDLMRRMVKEELLK
HHHHHEEEEEECCCCCCHHHHHHHHHHHCCCCCCCHHHCCCCCCCHHHHHHHHHHHHHHH
FDGRPLFPERIAYTVNYTLSDMEAYLYKEVTDYVREEFNRSDALENEGRKGTVGFALTIL
CCCCCCCHHHHEEEEEEHHHHHHHHHHHHHHHHHHHHHCHHHHHHCCCCCCHHHHHHHHH
QRRLASSPEAIYQSLKRRRERLEKRLQEEELLKRGATITLKES
HHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEECC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: DNA [C]

Specific reaction: Protein + DNA = Protein-DNA [C]

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: 8969508; 9384377 [H]