Definition Clostridium botulinum B1 str. Okra, complete genome.
Accession NC_010516
Length 3,958,233

Click here to switch to the map view.

The map label for this gene is yqiR [H]

Identifier: 170756965

GI number: 170756965

Start: 3472108

End: 3473736

Strand: Reverse

Name: yqiR [H]

Synonym: CLD_1335

Alternate gene names: 170756965

Gene position: 3473736-3472108 (Counterclockwise)

Preceding gene: 170755641

Following gene: 170757166

Centisome position: 87.76

GC content: 25.17

Gene sequence:

>1629_bases
ATGTTTATGGAAGAAGACTTTAAAATTATAAGTGAAAATATTAACAAGGGTACAATTAATATCAATAATAAAAATAATGT
ACTATCTGATAAATATTTATTAAAAAATAAAAGTAATAATAGGCATGTGGATATATTAAAAAATAAAGAAACCCATAAAA
AGATTAATAAAAATTCTAAGGTAGAAAGTAAAATAAGTATAAATGAATCAGAATGTGCAACTACTATAGATTATAAACTA
TACAGCGAAATGAAAAAAGATATAAAATATTATAAATCAGTTTTAGATGTTGTTAATAAAGTACTATATACAATAAACGA
ATGTATAGTAGTTGTGGATCAAAATGGAATAATTATAATGATGAGTGAATGCTATAAAAAGTTTATTAATTGCAAAGATC
CAGAGGGAAAATATGTTGAAGATGTTATAAAGGATACTATGTTACATAGAGTTTTAAAAACAGGGAACATAGAAAGTGGA
GAAGTACAAAAAATTAATGGCAAACAAGTAATTACTATGAGGATACCATTGAAAAAAGAAGGTAGAATTATTGGAGCAAT
AGGCAAAATAATGTTTAAAGATGTGAATGATTTTTATTTTTTATATGGAAAGTTAAATAAGTCAAAAAATACACATAAAT
GTTACGATAATAAATCAGAAAAAAATAGACGAGCTAAATATTTTTTTAAGGATATTGTTGGAGATTCCTCTGAAAGTAAT
AATATTAAAAGTTTAGCTAAGAAATCTGCAAATACAAATTCGAATGTTTTAATAGTAGGAGAAAGTGGAACAGGTAAAGA
ATTATATGCTCATTCAATTCATAATGCTAGTAATAGAAGATTAGGGCCTTTTATAAAAATTAACTGTGGGGCTATACCAG
CTGAATTGTTAGAGTCTGAATTATTTGGATATGAAGATGGTGCTTTTACAGGAGCTAAAAAAGGGGGAAAAAGAGGAAAA
TTTGAGTTGGCAAATGGAGGTACTATATTTTTAGATGAAATTGGTGATATGCCAATGTGTATGCAAGTTAAGCTTCTAAG
AGTCATTCAAGAAAGAGAAGTAGAAAAAGTGGGGGGCAATATACTAAAGAAAATTGATGTTAGGATAATTGCAGCTACAA
ATAAAAATCTTGAAAAGTTAGTCGAAAAAAATAAATTTAGAGAAGATTTATATTATAGATTGAATGTTATAAGGATTAAT
GTTCCATCACTAAGAGAAAGAAAAGAAGATATATTATTAATATCAGATTTTTTAGTAAAAAAAGTATCTCATAGATTAGG
CATATGTATAAAAGGAATATCTAAAGAAGCTAAAGAATATTTATGTAATTATAATTGGCCAGGAAATATTAGGGAGCTTG
AGAATGTAATAGAACGATCTGCAAATTTATTAGACTCAGATTTTGTTATAAAGCCAAAACATTTACCAAAAGAAATATTA
AAAAGCTATATTGTAAAAGCTCCCACTAAAGAAAATAAATATTTAAAAGACATAATTTCAGAAGTAGAAAAAGAAGTTAT
TTGTAACTGTTTAGAAAAAAATAATGGAAATAAAAATAAAACCTCTAAGATACTAGGAATAAGTAGAGCAAATTTGTATA
AGAAAATATCAGAATATAATATAGTTTAA

Upstream 100 bases:

>100_bases
TTTTAACAATGTAAAGATATGTATTATAAAAGAATATTTGTCAAATATTGCATCAAGGTATATAATGAAGTTATAGGTAA
TTACTTAGGGGGTATATTCT

Downstream 100 bases:

>100_bases
CTTGATAAAATATAAAAACAACAGAGCCATTATTAAGTGCTCTGTTGTTTTTTTTATTTCATTTTTAAGAAGATGTTTTT
CTATATTCTAAGGTATTACT

Product: sigma-54 dependent transcriptional regulator

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 542; Mature: 542

Protein sequence:

>542_residues
MFMEEDFKIISENINKGTININNKNNVLSDKYLLKNKSNNRHVDILKNKETHKKINKNSKVESKISINESECATTIDYKL
YSEMKKDIKYYKSVLDVVNKVLYTINECIVVVDQNGIIIMMSECYKKFINCKDPEGKYVEDVIKDTMLHRVLKTGNIESG
EVQKINGKQVITMRIPLKKEGRIIGAIGKIMFKDVNDFYFLYGKLNKSKNTHKCYDNKSEKNRRAKYFFKDIVGDSSESN
NIKSLAKKSANTNSNVLIVGESGTGKELYAHSIHNASNRRLGPFIKINCGAIPAELLESELFGYEDGAFTGAKKGGKRGK
FELANGGTIFLDEIGDMPMCMQVKLLRVIQEREVEKVGGNILKKIDVRIIAATNKNLEKLVEKNKFREDLYYRLNVIRIN
VPSLRERKEDILLISDFLVKKVSHRLGICIKGISKEAKEYLCNYNWPGNIRELENVIERSANLLDSDFVIKPKHLPKEIL
KSYIVKAPTKENKYLKDIISEVEKEVICNCLEKNNGNKNKTSKILGISRANLYKKISEYNIV

Sequences:

>Translated_542_residues
MFMEEDFKIISENINKGTININNKNNVLSDKYLLKNKSNNRHVDILKNKETHKKINKNSKVESKISINESECATTIDYKL
YSEMKKDIKYYKSVLDVVNKVLYTINECIVVVDQNGIIIMMSECYKKFINCKDPEGKYVEDVIKDTMLHRVLKTGNIESG
EVQKINGKQVITMRIPLKKEGRIIGAIGKIMFKDVNDFYFLYGKLNKSKNTHKCYDNKSEKNRRAKYFFKDIVGDSSESN
NIKSLAKKSANTNSNVLIVGESGTGKELYAHSIHNASNRRLGPFIKINCGAIPAELLESELFGYEDGAFTGAKKGGKRGK
FELANGGTIFLDEIGDMPMCMQVKLLRVIQEREVEKVGGNILKKIDVRIIAATNKNLEKLVEKNKFREDLYYRLNVIRIN
VPSLRERKEDILLISDFLVKKVSHRLGICIKGISKEAKEYLCNYNWPGNIRELENVIERSANLLDSDFVIKPKHLPKEIL
KSYIVKAPTKENKYLKDIISEVEKEVICNCLEKNNGNKNKTSKILGISRANLYKKISEYNIV
>Mature_542_residues
MFMEEDFKIISENINKGTININNKNNVLSDKYLLKNKSNNRHVDILKNKETHKKINKNSKVESKISINESECATTIDYKL
YSEMKKDIKYYKSVLDVVNKVLYTINECIVVVDQNGIIIMMSECYKKFINCKDPEGKYVEDVIKDTMLHRVLKTGNIESG
EVQKINGKQVITMRIPLKKEGRIIGAIGKIMFKDVNDFYFLYGKLNKSKNTHKCYDNKSEKNRRAKYFFKDIVGDSSESN
NIKSLAKKSANTNSNVLIVGESGTGKELYAHSIHNASNRRLGPFIKINCGAIPAELLESELFGYEDGAFTGAKKGGKRGK
FELANGGTIFLDEIGDMPMCMQVKLLRVIQEREVEKVGGNILKKIDVRIIAATNKNLEKLVEKNKFREDLYYRLNVIRIN
VPSLRERKEDILLISDFLVKKVSHRLGICIKGISKEAKEYLCNYNWPGNIRELENVIERSANLLDSDFVIKPKHLPKEIL
KSYIVKAPTKENKYLKDIISEVEKEVICNCLEKNNGNKNKTSKILGISRANLYKKISEYNIV

Specific function: Member Of The Two-Component Regulatory System Zras/Zrar. When Activated By Zras It Acts In Conjunction With Sigma-54 To Regulate The Expression Of Zrap. Positively Autoregulates The Expression Of The Zrasr Operon. [C]

COG id: COG3829

COG function: function code KT; Transcriptional regulator containing PAS, AAA-type ATPase, and DNA-binding domains

Gene ontology:

Cell location: Cytoplasmic [H]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 sigma-54 factor interaction domain [H]

Homologues:

Organism=Escherichia coli, GI1790437, Length=341, Percent_Identity=44.2815249266862, Blast_Score=287, Evalue=1e-78,
Organism=Escherichia coli, GI1788550, Length=320, Percent_Identity=47.5, Blast_Score=285, Evalue=5e-78,
Organism=Escherichia coli, GI1789233, Length=340, Percent_Identity=43.2352941176471, Blast_Score=278, Evalue=5e-76,
Organism=Escherichia coli, GI1786524, Length=367, Percent_Identity=36.7847411444142, Blast_Score=261, Evalue=9e-71,
Organism=Escherichia coli, GI87082117, Length=327, Percent_Identity=42.5076452599388, Blast_Score=258, Evalue=7e-70,
Organism=Escherichia coli, GI1790299, Length=332, Percent_Identity=38.5542168674699, Blast_Score=257, Evalue=2e-69,
Organism=Escherichia coli, GI1789087, Length=319, Percent_Identity=44.2006269592476, Blast_Score=254, Evalue=9e-69,
Organism=Escherichia coli, GI1788905, Length=388, Percent_Identity=38.4020618556701, Blast_Score=254, Evalue=1e-68,
Organism=Escherichia coli, GI87082152, Length=310, Percent_Identity=37.4193548387097, Blast_Score=225, Evalue=7e-60,
Organism=Escherichia coli, GI87081872, Length=311, Percent_Identity=39.871382636656, Blast_Score=223, Evalue=3e-59,
Organism=Escherichia coli, GI1787583, Length=357, Percent_Identity=35.0140056022409, Blast_Score=220, Evalue=2e-58,
Organism=Escherichia coli, GI87081858, Length=327, Percent_Identity=31.4984709480122, Blast_Score=162, Evalue=7e-41,
Organism=Escherichia coli, GI1789828, Length=233, Percent_Identity=33.0472103004292, Blast_Score=135, Evalue=9e-33,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR003593
- InterPro:   IPR020441
- InterPro:   IPR009057
- InterPro:   IPR012287
- InterPro:   IPR002197
- InterPro:   IPR016040
- InterPro:   IPR001610
- InterPro:   IPR000014
- InterPro:   IPR013767
- InterPro:   IPR002078 [H]

Pfam domain/function: PF02954 HTH_8; PF00989 PAS; PF00158 Sigma54_activat [H]

EC number: NA

Molecular weight: Translated: 62016; Mature: 62016

Theoretical pI: Translated: 9.88; Mature: 9.88

Prosite motif: PS00675 SIGMA54_INTERACT_1 ; PS00676 SIGMA54_INTERACT_2 ; PS00688 SIGMA54_INTERACT_3 ; PS50045 SIGMA54_INTERACT_4

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

2.0 %Cys     (Translated Protein)
2.0 %Met     (Translated Protein)
4.1 %Cys+Met (Translated Protein)
2.0 %Cys     (Mature Protein)
2.0 %Met     (Mature Protein)
4.1 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MFMEEDFKIISENINKGTININNKNNVLSDKYLLKNKSNNRHVDILKNKETHKKINKNSK
CCCCHHHHHHHCCCCCCEEEECCCCCCCCCHHHHCCCCCCCEEEEECCCHHHHHHCCCCC
VESKISINESECATTIDYKLYSEMKKDIKYYKSVLDVVNKVLYTINECIVVVDQNGIIIM
CCCEEECCHHHHHEHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCEEEEECCCCEEEE
MSECYKKFINCKDPEGKYVEDVIKDTMLHRVLKTGNIESGEVQKINGKQVITMRIPLKKE
HHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHCCCCCCCCEEEECCCEEEEEECCCCCC
GRIIGAIGKIMFKDVNDFYFLYGKLNKSKNTHKCYDNKSEKNRRAKYFFKDIVGDSSESN
CCEEEHHHHHHHHCCCCEEEEEEEECCCCCCCHHCCCCHHHHHHHHHHHHHHCCCCCCCC
NIKSLAKKSANTNSNVLIVGESGTGKELYAHSIHNASNRRLGPFIKINCGAIPAELLESE
HHHHHHHHCCCCCCCEEEEECCCCCHHHHHHHHCCCCCCCCCCEEEEECCCCCHHHHHHH
LFGYEDGAFTGAKKGGKRGKFELANGGTIFLDEIGDMPMCMQVKLLRVIQEREVEKVGGN
HCCCCCCCCCCCCCCCCCCCEEECCCCEEEEECCCCCCHHHHHHHHHHHHHHHHHHHHHH
ILKKIDVRIIAATNKNLEKLVEKNKFREDLYYRLNVIRINVPSLRERKEDILLISDFLVK
HHHEEEEEEEEECCCHHHHHHHHHHHHHHHEEEEEEEEEECCHHHHCHHCEEHHHHHHHH
KVSHRLGICIKGISKEAKEYLCNYNWPGNIRELENVIERSANLLDSDFVIKPKHLPKEIL
HHHHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHCCCCCEECCCCCHHHHH
KSYIVKAPTKENKYLKDIISEVEKEVICNCLEKNNGNKNKTSKILGISRANLYKKISEYN
HHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHEECHHHHHHHHHHHCC
IV
CC
>Mature Secondary Structure
MFMEEDFKIISENINKGTININNKNNVLSDKYLLKNKSNNRHVDILKNKETHKKINKNSK
CCCCHHHHHHHCCCCCCEEEECCCCCCCCCHHHHCCCCCCCEEEEECCCHHHHHHCCCCC
VESKISINESECATTIDYKLYSEMKKDIKYYKSVLDVVNKVLYTINECIVVVDQNGIIIM
CCCEEECCHHHHHEHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCEEEEECCCCEEEE
MSECYKKFINCKDPEGKYVEDVIKDTMLHRVLKTGNIESGEVQKINGKQVITMRIPLKKE
HHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHCCCCCCCCEEEECCCEEEEEECCCCCC
GRIIGAIGKIMFKDVNDFYFLYGKLNKSKNTHKCYDNKSEKNRRAKYFFKDIVGDSSESN
CCEEEHHHHHHHHCCCCEEEEEEEECCCCCCCHHCCCCHHHHHHHHHHHHHHCCCCCCCC
NIKSLAKKSANTNSNVLIVGESGTGKELYAHSIHNASNRRLGPFIKINCGAIPAELLESE
HHHHHHHHCCCCCCCEEEEECCCCCHHHHHHHHCCCCCCCCCCEEEEECCCCCHHHHHHH
LFGYEDGAFTGAKKGGKRGKFELANGGTIFLDEIGDMPMCMQVKLLRVIQEREVEKVGGN
HCCCCCCCCCCCCCCCCCCCEEECCCCEEEEECCCCCCHHHHHHHHHHHHHHHHHHHHHH
ILKKIDVRIIAATNKNLEKLVEKNKFREDLYYRLNVIRINVPSLRERKEDILLISDFLVK
HHHEEEEEEEEECCCHHHHHHHHHHHHHHHEEEEEEEEEECCHHHHCHHCEEHHHHHHHH
KVSHRLGICIKGISKEAKEYLCNYNWPGNIRELENVIERSANLLDSDFVIKPKHLPKEIL
HHHHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHCCCCCEECCCCCHHHHH
KSYIVKAPTKENKYLKDIISEVEKEVICNCLEKNNGNKNKTSKILGISRANLYKKISEYN
HHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHEECHHHHHHHHHHHCC
IV
CC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 8969508; 9384377 [H]