Definition Clostridium botulinum A2 str. Kyoto chromosome, complete genome.
Accession NC_012563
Length 4,155,278

Click here to switch to the map view.

The map label for this gene is ydeE [H]

Identifier: 226947993

GI number: 226947993

Start: 912296

End: 913168

Strand: Reverse

Name: ydeE [H]

Synonym: CLM_0854

Alternate gene names: 226947993

Gene position: 913168-912296 (Counterclockwise)

Preceding gene: 226947995

Following gene: 226947992

Centisome position: 21.98

GC content: 36.31

Gene sequence:

>873_bases
TTGTTAGGGGATGAAGATATGGAGTGGATAGAACGATTAAATAGTGCTGTTAATTATATCGAAAAGAATATAAGAGAAAC
TATCGATTTGGAAGAAGTATCAAAGATTGCATGTTGCTCAACTTATCATTTCCAAAGAATGTTTGCCTATATAGCAGATA
TACCCTTATCAGAGTACATCCGCCGTAGGAGAATGTCATTGGCAGCTGTTGATTTACAGAGTGGCAATGAAAAAGTGATA
GATATTTCTCTAAAATATGGATATGATTCACCCACAGCATTTAACAGAGCTTTTAAAAGTGTACATGGTATAGCACCATC
TCGGGCGAAGGAAGAAGGTACAATATTAAAAGCATTTCCTCCTATCAGCTTCAAAATAACAATAAGAGGAGATATTGAAA
TGAATTACAGAATTGAAAAGAAAGACTCATTTAGAATTGTAGGTATCTCAGAACCATTAGAAACAGAAATGGAGAAAAAC
TTTGAAACTGTACCAAAAATGTGGGGTACAGCTGCAATGAATGGAACAATACCAAGACTTGCTGCCATGATGGATGGAAT
CCCCATGGGATTATTAGGAGTAAGCTCCTGTAATAACCTGGATAATTGGAGATACTATATTGCAGTTGCAAGTAGTCAAC
CAATAGAGAATGGCCTAGAAGAATACATTGTCCCTAGCTCCCTGTGGGCAATATTTTCAGGAAAAGGAACTGCCAAATCT
ATGCAGGAACTAGAAAAAAGAATCATAACTGAATGGCTTCCAACTTCAGGATATGAATATGGAAATGCACCAGATATTGA
GGTGTATTTAAAGGCAGACCCAGAGGATACTGAATATGAAGTATGGATTCCGGTTTTAAAAAAGGAGAATTAA

Upstream 100 bases:

>100_bases
GTTACGTTAATTTAAAATTGTGTAATAAAGATTATTTACATGTTCTCTCTTTATCGTGCAGAAAAAGAGAGGTAGAATTA
TCTGAAATGGAGTATTTTTA

Downstream 100 bases:

>100_bases
ACATGGTACATTTAGTATATTGCGATGACAAAGAAAAGGTATTAGAAAACAAGCATTCCATATAATTATGATAAATCGAA
ATTTTAGGTGGTGTTGCTAT

Product: AraC family transcriptional regulator

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 290; Mature: 290

Protein sequence:

>290_residues
MLGDEDMEWIERLNSAVNYIEKNIRETIDLEEVSKIACCSTYHFQRMFAYIADIPLSEYIRRRRMSLAAVDLQSGNEKVI
DISLKYGYDSPTAFNRAFKSVHGIAPSRAKEEGTILKAFPPISFKITIRGDIEMNYRIEKKDSFRIVGISEPLETEMEKN
FETVPKMWGTAAMNGTIPRLAAMMDGIPMGLLGVSSCNNLDNWRYYIAVASSQPIENGLEEYIVPSSLWAIFSGKGTAKS
MQELEKRIITEWLPTSGYEYGNAPDIEVYLKADPEDTEYEVWIPVLKKEN

Sequences:

>Translated_290_residues
MLGDEDMEWIERLNSAVNYIEKNIRETIDLEEVSKIACCSTYHFQRMFAYIADIPLSEYIRRRRMSLAAVDLQSGNEKVI
DISLKYGYDSPTAFNRAFKSVHGIAPSRAKEEGTILKAFPPISFKITIRGDIEMNYRIEKKDSFRIVGISEPLETEMEKN
FETVPKMWGTAAMNGTIPRLAAMMDGIPMGLLGVSSCNNLDNWRYYIAVASSQPIENGLEEYIVPSSLWAIFSGKGTAKS
MQELEKRIITEWLPTSGYEYGNAPDIEVYLKADPEDTEYEVWIPVLKKEN
>Mature_290_residues
MLGDEDMEWIERLNSAVNYIEKNIRETIDLEEVSKIACCSTYHFQRMFAYIADIPLSEYIRRRRMSLAAVDLQSGNEKVI
DISLKYGYDSPTAFNRAFKSVHGIAPSRAKEEGTILKAFPPISFKITIRGDIEMNYRIEKKDSFRIVGISEPLETEMEKN
FETVPKMWGTAAMNGTIPRLAAMMDGIPMGLLGVSSCNNLDNWRYYIAVASSQPIENGLEEYIVPSSLWAIFSGKGTAKS
MQELEKRIITEWLPTSGYEYGNAPDIEVYLKADPEDTEYEVWIPVLKKEN

Specific function: Binds To The Right Arm Of The Replication Origin Oric Of The E.Coli Chromosome. Rob Binding May Influence The Formation Of The Nucleoprotein Structure, Required For Oric Function In The Initiation Of Replication. [C]

COG id: COG2207

COG function: function code K; AraC-type DNA-binding domain-containing proteins

Gene ontology:

Cell location: Cytoplasmic [H]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 HTH araC/xylS-type DNA-binding domain [H]

Homologues:

Organism=Escherichia coli, GI1790857, Length=291, Percent_Identity=23.0240549828179, Blast_Score=68, Evalue=7e-13,
Organism=Escherichia coli, GI87081928, Length=98, Percent_Identity=31.6326530612245, Blast_Score=66, Evalue=2e-12,
Organism=Escherichia coli, GI1790497, Length=95, Percent_Identity=31.5789473684211, Blast_Score=64, Evalue=1e-11,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR010499
- InterPro:   IPR009057
- InterPro:   IPR012287
- InterPro:   IPR018062
- InterPro:   IPR020449
- InterPro:   IPR018060
- InterPro:   IPR011256 [H]

Pfam domain/function: PF06445 AraC_E_bind; PF00165 HTH_AraC [H]

EC number: NA

Molecular weight: Translated: 33017; Mature: 33017

Theoretical pI: Translated: 4.64; Mature: 4.64

Prosite motif: PS00041 HTH_ARAC_FAMILY_1 ; PS01124 HTH_ARAC_FAMILY_2

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.0 %Cys     (Translated Protein)
4.1 %Met     (Translated Protein)
5.2 %Cys+Met (Translated Protein)
1.0 %Cys     (Mature Protein)
4.1 %Met     (Mature Protein)
5.2 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MLGDEDMEWIERLNSAVNYIEKNIRETIDLEEVSKIACCSTYHFQRMFAYIADIPLSEYI
CCCCHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHH
RRRRMSLAAVDLQSGNEKVIDISLKYGYDSPTAFNRAFKSVHGIAPSRAKEEGTILKAFP
HHHHHHHEEEEECCCCCEEEEEEEEECCCCCHHHHHHHHHHHCCCCCCCCCCCCEEEECC
PISFKITIRGDIEMNYRIEKKDSFRIVGISEPLETEMEKNFETVPKMWGTAAMNGTIPRL
CCEEEEEEEECEEEEEEEECCCCEEEEECCCCHHHHHHHHHHHHHHHHCCHHCCCCHHHH
AAMMDGIPMGLLGVSSCNNLDNWRYYIAVASSQPIENGLEEYIVPSSLWAIFSGKGTAKS
HHHHCCCCEEEEECCCCCCCCCEEEEEEEECCCCHHHHHHHHCCCHHHHHEECCCCCHHH
MQELEKRIITEWLPTSGYEYGNAPDIEVYLKADPEDTEYEVWIPVLKKEN
HHHHHHHHHHHHCCCCCCCCCCCCCEEEEEECCCCCCCEEEEEEEEECCC
>Mature Secondary Structure
MLGDEDMEWIERLNSAVNYIEKNIRETIDLEEVSKIACCSTYHFQRMFAYIADIPLSEYI
CCCCHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHH
RRRRMSLAAVDLQSGNEKVIDISLKYGYDSPTAFNRAFKSVHGIAPSRAKEEGTILKAFP
HHHHHHHEEEEECCCCCEEEEEEEEECCCCCHHHHHHHHHHHCCCCCCCCCCCCEEEECC
PISFKITIRGDIEMNYRIEKKDSFRIVGISEPLETEMEKNFETVPKMWGTAAMNGTIPRL
CCEEEEEEEECEEEEEEEECCCCEEEEECCCCHHHHHHHHHHHHHHHHCCHHCCCCHHHH
AAMMDGIPMGLLGVSSCNNLDNWRYYIAVASSQPIENGLEEYIVPSSLWAIFSGKGTAKS
HHHHCCCCEEEEECCCCCCCCCEEEEEEEECCCCHHHHHHHHCCCHHHHHEECCCCCHHH
MQELEKRIITEWLPTSGYEYGNAPDIEVYLKADPEDTEYEVWIPVLKKEN
HHHHHHHHHHHHCCCCCCCCCCCCCEEEEEECCCCCCCEEEEEEEEECCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: DNA [C]

Specific reaction: Protein + DNA = Protein-DNA [C]

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: 9384377 [H]