| Definition | Clostridium botulinum A str. Hall, complete genome. |
|---|---|
| Accession | NC_009698 |
| Length | 3,760,560 |
Click here to switch to the map view.
The map label for this gene is ydeE [H]
Identifier: 153937237
GI number: 153937237
Start: 2163023
End: 2163907
Strand: Reverse
Name: ydeE [H]
Synonym: CLC_2040
Alternate gene names: 153937237
Gene position: 2163907-2163023 (Counterclockwise)
Preceding gene: 153936432
Following gene: 153935505
Centisome position: 57.54
GC content: 30.17
Gene sequence:
>885_bases TTGGAAACAATCATGTTACTTAACAATACACTTGAATATATTGAAAGAAATTTGCATACGGCAATTAATATAGATGATAT ATCAAAAGTTGCATGTTCATCACGATATCACTTTCAGCGTGTTTTTCATTCATTAACAGGATTTACAGTAACTCAGTATA TAAAAAATCGCAGACTTACCCTTGCCGCAGAGGAGTTGGTTTCAACAGACAGAAGAATAATTGATATAGCATTGAAATAT GGTTATGAAAGTCCAGAAGCATTTACTAAAGCATTTAAAAGATTACATGGAATATCACCATCAGCTTTAAAAAAGCTTAA TGGAAAAATTAAAGCTTTTCCCAAAATCTCTTTTCAAATATCTATAAAAGGAGAGTGCGAAATCATTTATAGAATAGTTG AAAAAGAAGCATTTAAGGTATTTGGTACAGGATTTGAAACAACTAGAATTAATTATGCGGCTTATAAAGAAATACCAGAA TTTATTAATAAGATTTTTAAAGATGGAACACATGATAGAATTAATGAAGCATTAGGTAATTCTAAAGGTAGTTTATTAGA TGGATTTCATTATGATTTTAAAGAAAATGGTACAAGAAAATATATGATGGGATATGAAATACCTAGAACAGAGATATCAG ATGAATTTACAATACTTCAAGTACCTAAGCTTACATGGGCAGTATTTGAAGGATATGGGGCTATGCCAGATAACTTGATT ATACAGGATATATGGAGACGTATATATTCTGAATGGTTTCCATCCTCTGGATTTGAGCAAGTGGAAGGTCCATGTATTGA AAAAAATTTTTGGAATAATAAAAAACATGATGAATACAAATGCGAAGTATGGATTCCCGTAAAAACAAAGTCAATCAATT GGTGA
Upstream 100 bases:
>100_bases GTATTGTGAAGTTATAACAAATTACATATATAATAAGATGAAATGCGTGTGATTTACGTTCTTATAATGAATGAACTTAT TTTGAAAGGAGATGAGAAGC
Downstream 100 bases:
>100_bases CTTCGTTGTTATGTTTACTAACTATCAATAAAATGAGAACAGACCACATCATGGAATGGTATATCCATGATGTGGTTTGT TTTTTGAAATAAGGCAATGG
Product: AraC family transcriptional regulator
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 294; Mature: 294
Protein sequence:
>294_residues METIMLLNNTLEYIERNLHTAINIDDISKVACSSRYHFQRVFHSLTGFTVTQYIKNRRLTLAAEELVSTDRRIIDIALKY GYESPEAFTKAFKRLHGISPSALKKLNGKIKAFPKISFQISIKGECEIIYRIVEKEAFKVFGTGFETTRINYAAYKEIPE FINKIFKDGTHDRINEALGNSKGSLLDGFHYDFKENGTRKYMMGYEIPRTEISDEFTILQVPKLTWAVFEGYGAMPDNLI IQDIWRRIYSEWFPSSGFEQVEGPCIEKNFWNNKKHDEYKCEVWIPVKTKSINW
Sequences:
>Translated_294_residues METIMLLNNTLEYIERNLHTAINIDDISKVACSSRYHFQRVFHSLTGFTVTQYIKNRRLTLAAEELVSTDRRIIDIALKY GYESPEAFTKAFKRLHGISPSALKKLNGKIKAFPKISFQISIKGECEIIYRIVEKEAFKVFGTGFETTRINYAAYKEIPE FINKIFKDGTHDRINEALGNSKGSLLDGFHYDFKENGTRKYMMGYEIPRTEISDEFTILQVPKLTWAVFEGYGAMPDNLI IQDIWRRIYSEWFPSSGFEQVEGPCIEKNFWNNKKHDEYKCEVWIPVKTKSINW >Mature_294_residues METIMLLNNTLEYIERNLHTAINIDDISKVACSSRYHFQRVFHSLTGFTVTQYIKNRRLTLAAEELVSTDRRIIDIALKY GYESPEAFTKAFKRLHGISPSALKKLNGKIKAFPKISFQISIKGECEIIYRIVEKEAFKVFGTGFETTRINYAAYKEIPE FINKIFKDGTHDRINEALGNSKGSLLDGFHYDFKENGTRKYMMGYEIPRTEISDEFTILQVPKLTWAVFEGYGAMPDNLI IQDIWRRIYSEWFPSSGFEQVEGPCIEKNFWNNKKHDEYKCEVWIPVKTKSINW
Specific function: Binds To The Right Arm Of The Replication Origin Oric Of The E.Coli Chromosome. Rob Binding May Influence The Formation Of The Nucleoprotein Structure, Required For Oric Function In The Initiation Of Replication. [C]
COG id: COG2207
COG function: function code K; AraC-type DNA-binding domain-containing proteins
Gene ontology:
Cell location: Cytoplasmic [H]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 1 HTH araC/xylS-type DNA-binding domain [H]
Homologues:
Organism=Escherichia coli, GI1790857, Length=105, Percent_Identity=33.3333333333333, Blast_Score=76, Evalue=2e-15, Organism=Escherichia coli, GI1790497, Length=96, Percent_Identity=36.4583333333333, Blast_Score=75, Evalue=7e-15, Organism=Escherichia coli, GI87081928, Length=101, Percent_Identity=30.6930693069307, Blast_Score=70, Evalue=1e-13,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR010499 - InterPro: IPR009057 - InterPro: IPR012287 - InterPro: IPR018062 - InterPro: IPR020449 - InterPro: IPR018060 - InterPro: IPR011256 [H]
Pfam domain/function: PF06445 AraC_E_bind; PF00165 HTH_AraC [H]
EC number: NA
Molecular weight: Translated: 34309; Mature: 34309
Theoretical pI: Translated: 8.54; Mature: 8.54
Prosite motif: PS00041 HTH_ARAC_FAMILY_1 ; PS01124 HTH_ARAC_FAMILY_2
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.4 %Cys (Translated Protein) 1.7 %Met (Translated Protein) 3.1 %Cys+Met (Translated Protein) 1.4 %Cys (Mature Protein) 1.7 %Met (Mature Protein) 3.1 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure METIMLLNNTLEYIERNLHTAINIDDISKVACSSRYHFQRVFHSLTGFTVTQYIKNRRLT CCEEEEHHHHHHHHHHHHHCEECHHHHHHHHHHHHHHHHHHHHHHHCHHHHHHHHCCCCE LAAEELVSTDRRIIDIALKYGYESPEAFTKAFKRLHGISPSALKKLNGKIKAFPKISFQI EHHHHHHHCCHHHEEHHHHCCCCCHHHHHHHHHHHHCCCHHHHHHHCCCEEECEEEEEEE SIKGECEIIYRIVEKEAFKVFGTGFETTRINYAAYKEIPEFINKIFKDGTHDRINEALGN EECCCHHHHHHHHHHHHHHHHCCCCCCEEEHHHHHHHHHHHHHHHHCCCCHHHHHHHHCC SKGSLLDGFHYDFKENGTRKYMMGYEIPRTEISDEFTILQVPKLTWAVFEGYGAMPDNLI CCCCCCCCCCCCCCCCCCEEEEECCCCCCCCCCCCEEEEEECHHHHHHHHCCCCCCCHHH IQDIWRRIYSEWFPSSGFEQVEGPCIEKNFWNNKKHDEYKCEVWIPVKTKSINW HHHHHHHHHHHHCCCCCCHHHCCCEECCCCCCCCCCCCEEEEEEEEEECCCCCC >Mature Secondary Structure METIMLLNNTLEYIERNLHTAINIDDISKVACSSRYHFQRVFHSLTGFTVTQYIKNRRLT CCEEEEHHHHHHHHHHHHHCEECHHHHHHHHHHHHHHHHHHHHHHHCHHHHHHHHCCCCE LAAEELVSTDRRIIDIALKYGYESPEAFTKAFKRLHGISPSALKKLNGKIKAFPKISFQI EHHHHHHHCCHHHEEHHHHCCCCCHHHHHHHHHHHHCCCHHHHHHHCCCEEECEEEEEEE SIKGECEIIYRIVEKEAFKVFGTGFETTRINYAAYKEIPEFINKIFKDGTHDRINEALGN EECCCHHHHHHHHHHHHHHHHCCCCCCEEEHHHHHHHHHHHHHHHHCCCCHHHHHHHHCC SKGSLLDGFHYDFKENGTRKYMMGYEIPRTEISDEFTILQVPKLTWAVFEGYGAMPDNLI CCCCCCCCCCCCCCCCCCEEEEECCCCCCCCCCCCEEEEEECHHHHHHHHCCCCCCCHHH IQDIWRRIYSEWFPSSGFEQVEGPCIEKNFWNNKKHDEYKCEVWIPVKTKSINW HHHHHHHHHHHHCCCCCCHHHCCCEECCCCCCCCCCCCEEEEEEEEEECCCCCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: DNA [C]
Specific reaction: Protein + DNA = Protein-DNA [C]
General reaction: NA
Inhibitor: NA
Structure determination priority: 10.0
TargetDB status: NA
Availability: NA
References: 9384377 [H]