| Definition | Clostridium botulinum A2 str. Kyoto chromosome, complete genome. |
|---|---|
| Accession | NC_012563 |
| Length | 4,155,278 |
Click here to switch to the map view.
The map label for this gene is ydeE [H]
Identifier: 226947993
GI number: 226947993
Start: 912296
End: 913168
Strand: Reverse
Name: ydeE [H]
Synonym: CLM_0854
Alternate gene names: 226947993
Gene position: 913168-912296 (Counterclockwise)
Preceding gene: 226947995
Following gene: 226947992
Centisome position: 21.98
GC content: 36.31
Gene sequence:
>873_bases TTGTTAGGGGATGAAGATATGGAGTGGATAGAACGATTAAATAGTGCTGTTAATTATATCGAAAAGAATATAAGAGAAAC TATCGATTTGGAAGAAGTATCAAAGATTGCATGTTGCTCAACTTATCATTTCCAAAGAATGTTTGCCTATATAGCAGATA TACCCTTATCAGAGTACATCCGCCGTAGGAGAATGTCATTGGCAGCTGTTGATTTACAGAGTGGCAATGAAAAAGTGATA GATATTTCTCTAAAATATGGATATGATTCACCCACAGCATTTAACAGAGCTTTTAAAAGTGTACATGGTATAGCACCATC TCGGGCGAAGGAAGAAGGTACAATATTAAAAGCATTTCCTCCTATCAGCTTCAAAATAACAATAAGAGGAGATATTGAAA TGAATTACAGAATTGAAAAGAAAGACTCATTTAGAATTGTAGGTATCTCAGAACCATTAGAAACAGAAATGGAGAAAAAC TTTGAAACTGTACCAAAAATGTGGGGTACAGCTGCAATGAATGGAACAATACCAAGACTTGCTGCCATGATGGATGGAAT CCCCATGGGATTATTAGGAGTAAGCTCCTGTAATAACCTGGATAATTGGAGATACTATATTGCAGTTGCAAGTAGTCAAC CAATAGAGAATGGCCTAGAAGAATACATTGTCCCTAGCTCCCTGTGGGCAATATTTTCAGGAAAAGGAACTGCCAAATCT ATGCAGGAACTAGAAAAAAGAATCATAACTGAATGGCTTCCAACTTCAGGATATGAATATGGAAATGCACCAGATATTGA GGTGTATTTAAAGGCAGACCCAGAGGATACTGAATATGAAGTATGGATTCCGGTTTTAAAAAAGGAGAATTAA
Upstream 100 bases:
>100_bases GTTACGTTAATTTAAAATTGTGTAATAAAGATTATTTACATGTTCTCTCTTTATCGTGCAGAAAAAGAGAGGTAGAATTA TCTGAAATGGAGTATTTTTA
Downstream 100 bases:
>100_bases ACATGGTACATTTAGTATATTGCGATGACAAAGAAAAGGTATTAGAAAACAAGCATTCCATATAATTATGATAAATCGAA ATTTTAGGTGGTGTTGCTAT
Product: AraC family transcriptional regulator
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 290; Mature: 290
Protein sequence:
>290_residues MLGDEDMEWIERLNSAVNYIEKNIRETIDLEEVSKIACCSTYHFQRMFAYIADIPLSEYIRRRRMSLAAVDLQSGNEKVI DISLKYGYDSPTAFNRAFKSVHGIAPSRAKEEGTILKAFPPISFKITIRGDIEMNYRIEKKDSFRIVGISEPLETEMEKN FETVPKMWGTAAMNGTIPRLAAMMDGIPMGLLGVSSCNNLDNWRYYIAVASSQPIENGLEEYIVPSSLWAIFSGKGTAKS MQELEKRIITEWLPTSGYEYGNAPDIEVYLKADPEDTEYEVWIPVLKKEN
Sequences:
>Translated_290_residues MLGDEDMEWIERLNSAVNYIEKNIRETIDLEEVSKIACCSTYHFQRMFAYIADIPLSEYIRRRRMSLAAVDLQSGNEKVI DISLKYGYDSPTAFNRAFKSVHGIAPSRAKEEGTILKAFPPISFKITIRGDIEMNYRIEKKDSFRIVGISEPLETEMEKN FETVPKMWGTAAMNGTIPRLAAMMDGIPMGLLGVSSCNNLDNWRYYIAVASSQPIENGLEEYIVPSSLWAIFSGKGTAKS MQELEKRIITEWLPTSGYEYGNAPDIEVYLKADPEDTEYEVWIPVLKKEN >Mature_290_residues MLGDEDMEWIERLNSAVNYIEKNIRETIDLEEVSKIACCSTYHFQRMFAYIADIPLSEYIRRRRMSLAAVDLQSGNEKVI DISLKYGYDSPTAFNRAFKSVHGIAPSRAKEEGTILKAFPPISFKITIRGDIEMNYRIEKKDSFRIVGISEPLETEMEKN FETVPKMWGTAAMNGTIPRLAAMMDGIPMGLLGVSSCNNLDNWRYYIAVASSQPIENGLEEYIVPSSLWAIFSGKGTAKS MQELEKRIITEWLPTSGYEYGNAPDIEVYLKADPEDTEYEVWIPVLKKEN
Specific function: Binds To The Right Arm Of The Replication Origin Oric Of The E.Coli Chromosome. Rob Binding May Influence The Formation Of The Nucleoprotein Structure, Required For Oric Function In The Initiation Of Replication. [C]
COG id: COG2207
COG function: function code K; AraC-type DNA-binding domain-containing proteins
Gene ontology:
Cell location: Cytoplasmic [H]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 1 HTH araC/xylS-type DNA-binding domain [H]
Homologues:
Organism=Escherichia coli, GI1790857, Length=291, Percent_Identity=23.0240549828179, Blast_Score=68, Evalue=7e-13, Organism=Escherichia coli, GI87081928, Length=98, Percent_Identity=31.6326530612245, Blast_Score=66, Evalue=2e-12, Organism=Escherichia coli, GI1790497, Length=95, Percent_Identity=31.5789473684211, Blast_Score=64, Evalue=1e-11,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR010499 - InterPro: IPR009057 - InterPro: IPR012287 - InterPro: IPR018062 - InterPro: IPR020449 - InterPro: IPR018060 - InterPro: IPR011256 [H]
Pfam domain/function: PF06445 AraC_E_bind; PF00165 HTH_AraC [H]
EC number: NA
Molecular weight: Translated: 33017; Mature: 33017
Theoretical pI: Translated: 4.64; Mature: 4.64
Prosite motif: PS00041 HTH_ARAC_FAMILY_1 ; PS01124 HTH_ARAC_FAMILY_2
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.0 %Cys (Translated Protein) 4.1 %Met (Translated Protein) 5.2 %Cys+Met (Translated Protein) 1.0 %Cys (Mature Protein) 4.1 %Met (Mature Protein) 5.2 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MLGDEDMEWIERLNSAVNYIEKNIRETIDLEEVSKIACCSTYHFQRMFAYIADIPLSEYI CCCCHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHH RRRRMSLAAVDLQSGNEKVIDISLKYGYDSPTAFNRAFKSVHGIAPSRAKEEGTILKAFP HHHHHHHEEEEECCCCCEEEEEEEEECCCCCHHHHHHHHHHHCCCCCCCCCCCCEEEECC PISFKITIRGDIEMNYRIEKKDSFRIVGISEPLETEMEKNFETVPKMWGTAAMNGTIPRL CCEEEEEEEECEEEEEEEECCCCEEEEECCCCHHHHHHHHHHHHHHHHCCHHCCCCHHHH AAMMDGIPMGLLGVSSCNNLDNWRYYIAVASSQPIENGLEEYIVPSSLWAIFSGKGTAKS HHHHCCCCEEEEECCCCCCCCCEEEEEEEECCCCHHHHHHHHCCCHHHHHEECCCCCHHH MQELEKRIITEWLPTSGYEYGNAPDIEVYLKADPEDTEYEVWIPVLKKEN HHHHHHHHHHHHCCCCCCCCCCCCCEEEEEECCCCCCCEEEEEEEEECCC >Mature Secondary Structure MLGDEDMEWIERLNSAVNYIEKNIRETIDLEEVSKIACCSTYHFQRMFAYIADIPLSEYI CCCCHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHH RRRRMSLAAVDLQSGNEKVIDISLKYGYDSPTAFNRAFKSVHGIAPSRAKEEGTILKAFP HHHHHHHEEEEECCCCCEEEEEEEEECCCCCHHHHHHHHHHHCCCCCCCCCCCCEEEECC PISFKITIRGDIEMNYRIEKKDSFRIVGISEPLETEMEKNFETVPKMWGTAAMNGTIPRL CCEEEEEEEECEEEEEEEECCCCEEEEECCCCHHHHHHHHHHHHHHHHCCHHCCCCHHHH AAMMDGIPMGLLGVSSCNNLDNWRYYIAVASSQPIENGLEEYIVPSSLWAIFSGKGTAKS HHHHCCCCEEEEECCCCCCCCCEEEEEEEECCCCHHHHHHHHCCCHHHHHEECCCCCHHH MQELEKRIITEWLPTSGYEYGNAPDIEVYLKADPEDTEYEVWIPVLKKEN HHHHHHHHHHHHCCCCCCCCCCCCCEEEEEECCCCCCCEEEEEEEEECCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: DNA [C]
Specific reaction: Protein + DNA = Protein-DNA [C]
General reaction: NA
Inhibitor: NA
Structure determination priority: 10.0
TargetDB status: NA
Availability: NA
References: 9384377 [H]