The gene/protein map for NC_012563 is currently unavailable.
Definition Clostridium botulinum A2 str. Kyoto chromosome, complete genome.
Accession NC_012563
Length 4,155,278

Click here to switch to the map view.

The map label for this gene is aorR [H]

Identifier: 226949235

GI number: 226949235

Start: 2209814

End: 2211709

Strand: Reverse

Name: aorR [H]

Synonym: CLM_2154

Alternate gene names: 226949235

Gene position: 2211709-2209814 (Counterclockwise)

Preceding gene: 226949236

Following gene: 226949234

Centisome position: 53.23

GC content: 29.85

Gene sequence:

>1896_bases
ATGAAGGATAATTTCATAAATGAGAAGTTTTGTATATTAAAATCTCATGAAAAATGTAATAGTTTAGGGATTAGCAAAGA
TTTAGTATACAGTAAAAAAATAATAAAGGATGAAGAACTTAAGAGGGAATTAAATAATAATTCAGAGTTAATTATTATTG
CTACACCTTTTATGAATAAGCTCTACCAATTTGTTAAGGGCTCTAACTTTTTCGTTATTCTTACAGATGGGGATGGTTGC
ATATTAAATGTCATAGGAGATGAAAGTATATTAAAGGAAGCTTCTAATGTGAAAATGATTCCAGGAGCTTATATGGATGA
AAAAAATATGGGGACAAACGCCATGAGTATGGCTTTAAGTGAAAAATCTCCAATTCAGATATCTGGAGAGGACCATTACG
TTAAAGCTTATCATAGATGGACTTGTTCTGCAGCTCCCATAAAAGATATTAATGGGAAAATAATTGGGATTCTTGATTTG
ACAGGATATAGTGAAAATGTACATTCTCATACCTTAGGAATGGTAGCAGCTGCAACTAATGCCATTGAAAAAATGATAGA
ATTAAATGATTATAATAGAGCTTTACAAATATCCAAAAAGAGTATTGAGAATGTATTTAATTCTATACAAAGAGCTATAT
TAAGGGTGGATTTGTCAGGTGCAATAAAGACCATAAATAACAACGCTATAGAACTTTTAGGTTTTAATGAAAATGATATA
AAAAGTATGAAGATGTGGGATTTAATACCTGACTGGTCTATGGTTTTAGATGAAATCTACGACAAAGGTAGTTTTGTAGA
TGAAGATGTATATGTACACTGTCTTAAAAATAAACTTCAATTGAATTTAAGCGCATATCCTATATATGATTCATCCATGA
GAATTATTGAGGTAACCTGTTTACTTTCAGATATACAAAAAACTCGAAAACTTGCAGGAAAAATACTTAGTGGTCAAGCC
ATTTATACTTTTGATAAAATTATAGGCAAAAGCAAAAAACTTCTTAGCATAATAGATTATTCAAAAAAAATTGCAGATAG
CAGATCTACTATACTTATTACCGGTGATAGTGGAACGGGAAAGGAAGTTTTTGCACAGTCAATACACAACTATAGTGATA
GAAAAGATAAGCCTTTTATAGCTGTTAATTGCGGAGCTATCCCAAGAAATTTGATTGAATCTGAACTTTTTGGATATGAA
GAAGGAGCCTTTACTGGAGCAAAAAGAGGAGGATATAGAGGGAAATTTGAGAATTCACATGGTGGAACCATATTTCTTGA
TGAAATAGGGGAGATGCCTTTAGATATGCAAATAAAACTTTTAAGGGTTATAGAAGAGGGCGTTATAAATAGAATAGGAA
GTTCTAAACAAATACCTGTAAATTCTAGAATAATAGCTGCCACTAATAAAGATTTAAGAGAAGAGGTAGAGAAGGGAAAT
TTTAGAAAGGATTTATTTTATAGAATAAATGTATTACCAGTATATTTACCAGCATTAAAAAAAAGAAGAGAGGATATACC
TTTACTTATAGATTATTTTATGAATAAAACATCTAAACATTTAAATAAAAGAAAGGTAGAAATACCTTCTGTATATATGG
AAAGGCTTATGAATTATCATTGGCCAGGTAATATAAGAGAATTAGAAAATATAGTAGAATTAATAATAAATGCAGAAAGT
GTTGAAATTATTAATAATATAAACCATTATAGTAGCAAGGAAGTTAGAGATAAGGCAAAAGAAGAAACTATGGTATTTAA
TCTTGAAATTGTGGAGAAAAACCACATTAAAGAGGTATTAAATAAGTTTGATGGTAATGTTTCTTCCGCTGCAAGGGCTC
TTGGCATAGGAAGAAATACTCTTTATAGAAAAATAGAAAAATACTCACTGTACTAA

Upstream 100 bases:

>100_bases
GAAGGCTTTATTAAACCTGGAGATGAAATAGAGGTTTTATCCGATTTTTAGCATTAAAATTATTTGATAAGCTGTCTTTA
TCTTAAAGGGGAAGATTTAT

Downstream 100 bases:

>100_bases
TATAGAACAAAGTTCCAAAAAGGAACAATAAAACATAAAAAAATGTATCTAAATAGAACAAGAAGAATTGTTATTTTTAA
TATTAATTTTAAGTAAGTAT

Product: aor transcriptional regulator

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 631; Mature: 631

Protein sequence:

>631_residues
MKDNFINEKFCILKSHEKCNSLGISKDLVYSKKIIKDEELKRELNNNSELIIIATPFMNKLYQFVKGSNFFVILTDGDGC
ILNVIGDESILKEASNVKMIPGAYMDEKNMGTNAMSMALSEKSPIQISGEDHYVKAYHRWTCSAAPIKDINGKIIGILDL
TGYSENVHSHTLGMVAAATNAIEKMIELNDYNRALQISKKSIENVFNSIQRAILRVDLSGAIKTINNNAIELLGFNENDI
KSMKMWDLIPDWSMVLDEIYDKGSFVDEDVYVHCLKNKLQLNLSAYPIYDSSMRIIEVTCLLSDIQKTRKLAGKILSGQA
IYTFDKIIGKSKKLLSIIDYSKKIADSRSTILITGDSGTGKEVFAQSIHNYSDRKDKPFIAVNCGAIPRNLIESELFGYE
EGAFTGAKRGGYRGKFENSHGGTIFLDEIGEMPLDMQIKLLRVIEEGVINRIGSSKQIPVNSRIIAATNKDLREEVEKGN
FRKDLFYRINVLPVYLPALKKRREDIPLLIDYFMNKTSKHLNKRKVEIPSVYMERLMNYHWPGNIRELENIVELIINAES
VEIINNINHYSSKEVRDKAKEETMVFNLEIVEKNHIKEVLNKFDGNVSSAARALGIGRNTLYRKIEKYSLY

Sequences:

>Translated_631_residues
MKDNFINEKFCILKSHEKCNSLGISKDLVYSKKIIKDEELKRELNNNSELIIIATPFMNKLYQFVKGSNFFVILTDGDGC
ILNVIGDESILKEASNVKMIPGAYMDEKNMGTNAMSMALSEKSPIQISGEDHYVKAYHRWTCSAAPIKDINGKIIGILDL
TGYSENVHSHTLGMVAAATNAIEKMIELNDYNRALQISKKSIENVFNSIQRAILRVDLSGAIKTINNNAIELLGFNENDI
KSMKMWDLIPDWSMVLDEIYDKGSFVDEDVYVHCLKNKLQLNLSAYPIYDSSMRIIEVTCLLSDIQKTRKLAGKILSGQA
IYTFDKIIGKSKKLLSIIDYSKKIADSRSTILITGDSGTGKEVFAQSIHNYSDRKDKPFIAVNCGAIPRNLIESELFGYE
EGAFTGAKRGGYRGKFENSHGGTIFLDEIGEMPLDMQIKLLRVIEEGVINRIGSSKQIPVNSRIIAATNKDLREEVEKGN
FRKDLFYRINVLPVYLPALKKRREDIPLLIDYFMNKTSKHLNKRKVEIPSVYMERLMNYHWPGNIRELENIVELIINAES
VEIINNINHYSSKEVRDKAKEETMVFNLEIVEKNHIKEVLNKFDGNVSSAARALGIGRNTLYRKIEKYSLY
>Mature_631_residues
MKDNFINEKFCILKSHEKCNSLGISKDLVYSKKIIKDEELKRELNNNSELIIIATPFMNKLYQFVKGSNFFVILTDGDGC
ILNVIGDESILKEASNVKMIPGAYMDEKNMGTNAMSMALSEKSPIQISGEDHYVKAYHRWTCSAAPIKDINGKIIGILDL
TGYSENVHSHTLGMVAAATNAIEKMIELNDYNRALQISKKSIENVFNSIQRAILRVDLSGAIKTINNNAIELLGFNENDI
KSMKMWDLIPDWSMVLDEIYDKGSFVDEDVYVHCLKNKLQLNLSAYPIYDSSMRIIEVTCLLSDIQKTRKLAGKILSGQA
IYTFDKIIGKSKKLLSIIDYSKKIADSRSTILITGDSGTGKEVFAQSIHNYSDRKDKPFIAVNCGAIPRNLIESELFGYE
EGAFTGAKRGGYRGKFENSHGGTIFLDEIGEMPLDMQIKLLRVIEEGVINRIGSSKQIPVNSRIIAATNKDLREEVEKGN
FRKDLFYRINVLPVYLPALKKRREDIPLLIDYFMNKTSKHLNKRKVEIPSVYMERLMNYHWPGNIRELENIVELIINAES
VEIINNINHYSSKEVRDKAKEETMVFNLEIVEKNHIKEVLNKFDGNVSSAARALGIGRNTLYRKIEKYSLY

Specific function: Required For Induction Of Expression Of The Hydrogenase- 4 Structural Genes. [C]

COG id: COG3284

COG function: function code QK; Transcriptional activator of acetoin/glycerol metabolism

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 sigma-54 factor interaction domain [H]

Homologues:

Organism=Escherichia coli, GI87082117, Length=340, Percent_Identity=42.6470588235294, Blast_Score=276, Evalue=4e-75,
Organism=Escherichia coli, GI1789233, Length=452, Percent_Identity=36.283185840708, Blast_Score=258, Evalue=1e-69,
Organism=Escherichia coli, GI1788905, Length=306, Percent_Identity=41.1764705882353, Blast_Score=256, Evalue=2e-69,
Organism=Escherichia coli, GI1788550, Length=318, Percent_Identity=42.1383647798742, Blast_Score=251, Evalue=1e-67,
Organism=Escherichia coli, GI1790437, Length=304, Percent_Identity=42.7631578947368, Blast_Score=243, Evalue=2e-65,
Organism=Escherichia coli, GI1786524, Length=321, Percent_Identity=39.5638629283489, Blast_Score=243, Evalue=3e-65,
Organism=Escherichia coli, GI1789087, Length=311, Percent_Identity=40.5144694533762, Blast_Score=236, Evalue=2e-63,
Organism=Escherichia coli, GI1790299, Length=334, Percent_Identity=38.622754491018, Blast_Score=233, Evalue=2e-62,
Organism=Escherichia coli, GI87082152, Length=318, Percent_Identity=37.1069182389937, Blast_Score=206, Evalue=5e-54,
Organism=Escherichia coli, GI87081858, Length=647, Percent_Identity=23.6476043276662, Blast_Score=205, Evalue=7e-54,
Organism=Escherichia coli, GI1787583, Length=370, Percent_Identity=32.4324324324324, Blast_Score=200, Evalue=2e-52,
Organism=Escherichia coli, GI87081872, Length=233, Percent_Identity=43.3476394849785, Blast_Score=200, Evalue=2e-52,
Organism=Escherichia coli, GI1789828, Length=230, Percent_Identity=36.0869565217391, Blast_Score=132, Evalue=8e-32,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR003593
- InterPro:   IPR020441
- InterPro:   IPR009057
- InterPro:   IPR002197
- InterPro:   IPR001610
- InterPro:   IPR000014
- InterPro:   IPR013767
- InterPro:   IPR002078 [H]

Pfam domain/function: PF02954 HTH_8; PF00989 PAS; PF00158 Sigma54_activat [H]

EC number: NA

Molecular weight: Translated: 71629; Mature: 71629

Theoretical pI: Translated: 8.39; Mature: 8.39

Prosite motif: PS50112 PAS ; PS00675 SIGMA54_INTERACT_1 ; PS00688 SIGMA54_INTERACT_3 ; PS50045 SIGMA54_INTERACT_4

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.1 %Cys     (Translated Protein)
3.0 %Met     (Translated Protein)
4.1 %Cys+Met (Translated Protein)
1.1 %Cys     (Mature Protein)
3.0 %Met     (Mature Protein)
4.1 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKDNFINEKFCILKSHEKCNSLGISKDLVYSKKIIKDEELKRELNNNSELIIIATPFMNK
CCCCCCCCEEEEEECCHHHHHCCCCHHHHHHHHHHCHHHHHHHHCCCCCEEEEECHHHHH
LYQFVKGSNFFVILTDGDGCILNVIGDESILKEASNVKMIPGAYMDEKNMGTNAMSMALS
HHHHHCCCCEEEEEECCCCEEEEEECCHHHHHHCCCCEECCCCCCCCCCCCCHHHHHHCC
EKSPIQISGEDHYVKAYHRWTCSAAPIKDINGKIIGILDLTGYSENVHSHTLGMVAAATN
CCCCEEECCCCCEEEEEEEEECCCCCCCCCCCCEEEEEEECCCCCCCHHHHHHHHHHHHH
AIEKMIELNDYNRALQISKKSIENVFNSIQRAILRVDLSGAIKTINNNAIELLGFNENDI
HHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHEECCHHHEECCCCEEEEEECCCCCC
KSMKMWDLIPDWSMVLDEIYDKGSFVDEDVYVHCLKNKLQLNLSAYPIYDSSMRIIEVTC
CHHHHHHCCCCHHHHHHHHHCCCCCCCHHHHHHHHHHHHEEEEEEEEEECCCCEEEHHHH
LLSDIQKTRKLAGKILSGQAIYTFDKIIGKSKKLLSIIDYSKKIADSRSTILITGDSGTG
HHHHHHHHHHHHHHHHCCCEEEEHHHHHCCCHHHHHHHHHHHHHCCCCCEEEEECCCCCC
KEVFAQSIHNYSDRKDKPFIAVNCGAIPRNLIESELFGYEEGAFTGAKRGGYRGKFENSH
HHHHHHHHHCCCCCCCCCEEEEECCCCCHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCC
GGTIFLDEIGEMPLDMQIKLLRVIEEGVINRIGSSKQIPVNSRIIAATNKDLREEVEKGN
CCEEEEECCCCCCCCHHHHHHHHHHHHHHHHCCCCCCCCCCCEEEEECCHHHHHHHHCCC
FRKDLFYRINVLPVYLPALKKRREDIPLLIDYFMNKTSKHLNKRKVEIPSVYMERLMNYH
CCEEEEEEEEEHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHCCCCCHHHHHHHHHCCC
WPGNIRELENIVELIINAESVEIINNINHYSSKEVRDKAKEETMVFNLEIVEKNHIKEVL
CCCCHHHHHHHHHHHHCCHHHHHHHHCCCCCCHHHHHHHCCCEEEEEEEEECHHHHHHHH
NKFDGNVSSAARALGIGRNTLYRKIEKYSLY
HHHCCCHHHHHHHHCCCHHHHHHHHHHHCCC
>Mature Secondary Structure
MKDNFINEKFCILKSHEKCNSLGISKDLVYSKKIIKDEELKRELNNNSELIIIATPFMNK
CCCCCCCCEEEEEECCHHHHHCCCCHHHHHHHHHHCHHHHHHHHCCCCCEEEEECHHHHH
LYQFVKGSNFFVILTDGDGCILNVIGDESILKEASNVKMIPGAYMDEKNMGTNAMSMALS
HHHHHCCCCEEEEEECCCCEEEEEECCHHHHHHCCCCEECCCCCCCCCCCCCHHHHHHCC
EKSPIQISGEDHYVKAYHRWTCSAAPIKDINGKIIGILDLTGYSENVHSHTLGMVAAATN
CCCCEEECCCCCEEEEEEEEECCCCCCCCCCCCEEEEEEECCCCCCCHHHHHHHHHHHHH
AIEKMIELNDYNRALQISKKSIENVFNSIQRAILRVDLSGAIKTINNNAIELLGFNENDI
HHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHEECCHHHEECCCCEEEEEECCCCCC
KSMKMWDLIPDWSMVLDEIYDKGSFVDEDVYVHCLKNKLQLNLSAYPIYDSSMRIIEVTC
CHHHHHHCCCCHHHHHHHHHCCCCCCCHHHHHHHHHHHHEEEEEEEEEECCCCEEEHHHH
LLSDIQKTRKLAGKILSGQAIYTFDKIIGKSKKLLSIIDYSKKIADSRSTILITGDSGTG
HHHHHHHHHHHHHHHHCCCEEEEHHHHHCCCHHHHHHHHHHHHHCCCCCEEEEECCCCCC
KEVFAQSIHNYSDRKDKPFIAVNCGAIPRNLIESELFGYEEGAFTGAKRGGYRGKFENSH
HHHHHHHHHCCCCCCCCCEEEEECCCCCHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCC
GGTIFLDEIGEMPLDMQIKLLRVIEEGVINRIGSSKQIPVNSRIIAATNKDLREEVEKGN
CCEEEEECCCCCCCCHHHHHHHHHHHHHHHHCCCCCCCCCCCEEEEECCHHHHHHHHCCC
FRKDLFYRINVLPVYLPALKKRREDIPLLIDYFMNKTSKHLNKRKVEIPSVYMERLMNYH
CCEEEEEEEEEHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHCCCCCHHHHHHHHHCCC
WPGNIRELENIVELIINAESVEIINNINHYSSKEVRDKAKEETMVFNLEIVEKNHIKEVL
CCCCHHHHHHHHHHHHCCHHHHHHHHCCCCCCHHHHHHHCCCEEEEEEEEECHHHHHHHH
NKFDGNVSSAARALGIGRNTLYRKIEKYSLY
HHHCCCHHHHHHHHCCCHHHHHHHHHHHCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA