| Definition | Clostridium botulinum A str. Hall, complete genome. |
|---|---|
| Accession | NC_009698 |
| Length | 3,760,560 |
Click here to switch to the map view.
The map label for this gene is ybeQ [H]
Identifier: 153937616
GI number: 153937616
Start: 985763
End: 987469
Strand: Direct
Name: ybeQ [H]
Synonym: CLC_0961
Alternate gene names: 153937616
Gene position: 985763-987469 (Clockwise)
Preceding gene: 153935184
Following gene: 153935802
Centisome position: 26.21
GC content: 23.78
Gene sequence:
>1707_bases TTGGATAGATTTAGTTTTCTAAAAATAGAATGGCCTGAAATATATCAAATTATATGTAATGTAGAAGAAAAATCAAAGGA AGATTCTAATATAACATTAATTGAATTAGCACAGATAGCAGAATTAATAACAAAATACATATTAAAGGAAAACCATATTG AAAAAAATACCGAACTATTAGATGAAATAAATTTATTAAAAGACTGTCACAATTTAAATGCTGATATAGTAGATTTTTTT TATAAGATAATAATTGTTTCAAATAAAGCTATTTATGAAGACTATTCTGATTCAATTATAGCAAAGTCATTTTTAGATAA AATGTTTGAAATATTGGTATGGTTTGCAATAGAGTACGGGAAAACAGACTATAGGAAAGTTGATTTGAGTAATATGATTC CAGAAGATAAGGATATATTTAATAAATATATTAAAAGTAAATCATATAATTATACAGAAAAAAATATTGAAAATGAAACT ATGATACAGCCATTTACTATAGAAAATGAAGAATTTTTTAAAGAAGAAAATAACGATGACATTAATAGATATGAGCAGGA CGTATTTGAAACAAAGGAAGAATTTCATAAAAGAATAAGGAATCATGAGATATTTACTTTAGGTAGGATATTTATAGAAA AATCTAATATTAATGAAACGGATGAGATTGTTGCATTCCCATTTTCTGTATATAAATCAATTCAAATTAAGATACCAATT ATAGATATGTTATATATAGAAAGAGCTGAATTTGAAAATTTATCAATTGAAGAAGAGGAATATATACTATTTTCAAAATT AGATATTATAAATGATAAAATTTGCATTGACATTAATAATATTTATATTGAAGTGAGTAATAATAAATGCAAAGTTCATG CTGTAGTATTAGATATATCTTACTATGAAAGTTATGAAAAATATAGAAATATAATTTATTCTAAAAAACCTATTCCAATA GGAATGATTAAATTTAATAAAAATAAGTATGATATTAATAAAAATGAAATGCCCGTTACAATTAATTATTATGATTGGAT ACAAAAATATATTTTAAATACTAAGGCATACATAGAAATTCATAGATATGAAGCAAAAACCTTATGTAAAGAAAATTTGT ATTATATTTTAAATGGGAAATTAGACATTTTTGATAAAAAACTTTTAATAAGAGAATATTACATTCAATCCAAAAGTTTA AATAAAAATTTCAGAATAAATCTTCATAGTTCAGATCCAATGAATAAATTGAGGTGTTTAGTAGACAAAGAAGAAATATT AGCAATGAATATTATAGGTGAAATGTATTGTAAGGAACAAAACTATAAAGAAGCAATGTATTGGTATAAAAAAGCAGCAG AGAAAGGTAATTCTACTTCTATGAATAAGATAGGTGTCATGTATTATGAAGGAAAAGGAGTAGAACAAGACTACCAAAAA GCAATGTATTGGTATAAAAAATCATCGCAGGAAGGAAACTTCACTGCTATGAGTAATATAGGGTCTATGTATTATAATGG ACAGGGAGTAACGGAAGATTATAAAAAGGCAATGTATTGGTATAAAAAATCATACAAAGAAGGTAACTTTGGAGTTATGA GAGATATAGGAAGTATGTATTATGAAGGAAAAGGAGTAATAAAGGACTATAAAAAAGCAATGCAATGTTATAAAAAAGCA TCACAGATAGATAATTTTATTAAGTAG
Upstream 100 bases:
>100_bases TCATATAAATTTATTAATATCACAATTACTAAGTTATTAATATAATAATTTTAGAGGGAATATAATGATTTAATAGATAA TATATTTAGAGGTGTTTAAT
Downstream 100 bases:
>100_bases ATTATAATTGATATAGGTTACTAAGTATATTATTCTTGGTAGCCTATATTTTTATCTCATGACTATCTGCCATGATACTC CTATTTCTTCAAAAATAGAA
Product: hypothetical protein
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 568; Mature: 568
Protein sequence:
>568_residues MDRFSFLKIEWPEIYQIICNVEEKSKEDSNITLIELAQIAELITKYILKENHIEKNTELLDEINLLKDCHNLNADIVDFF YKIIIVSNKAIYEDYSDSIIAKSFLDKMFEILVWFAIEYGKTDYRKVDLSNMIPEDKDIFNKYIKSKSYNYTEKNIENET MIQPFTIENEEFFKEENNDDINRYEQDVFETKEEFHKRIRNHEIFTLGRIFIEKSNINETDEIVAFPFSVYKSIQIKIPI IDMLYIERAEFENLSIEEEEYILFSKLDIINDKICIDINNIYIEVSNNKCKVHAVVLDISYYESYEKYRNIIYSKKPIPI GMIKFNKNKYDINKNEMPVTINYYDWIQKYILNTKAYIEIHRYEAKTLCKENLYYILNGKLDIFDKKLLIREYYIQSKSL NKNFRINLHSSDPMNKLRCLVDKEEILAMNIIGEMYCKEQNYKEAMYWYKKAAEKGNSTSMNKIGVMYYEGKGVEQDYQK AMYWYKKSSQEGNFTAMSNIGSMYYNGQGVTEDYKKAMYWYKKSYKEGNFGVMRDIGSMYYEGKGVIKDYKKAMQCYKKA SQIDNFIK
Sequences:
>Translated_568_residues MDRFSFLKIEWPEIYQIICNVEEKSKEDSNITLIELAQIAELITKYILKENHIEKNTELLDEINLLKDCHNLNADIVDFF YKIIIVSNKAIYEDYSDSIIAKSFLDKMFEILVWFAIEYGKTDYRKVDLSNMIPEDKDIFNKYIKSKSYNYTEKNIENET MIQPFTIENEEFFKEENNDDINRYEQDVFETKEEFHKRIRNHEIFTLGRIFIEKSNINETDEIVAFPFSVYKSIQIKIPI IDMLYIERAEFENLSIEEEEYILFSKLDIINDKICIDINNIYIEVSNNKCKVHAVVLDISYYESYEKYRNIIYSKKPIPI GMIKFNKNKYDINKNEMPVTINYYDWIQKYILNTKAYIEIHRYEAKTLCKENLYYILNGKLDIFDKKLLIREYYIQSKSL NKNFRINLHSSDPMNKLRCLVDKEEILAMNIIGEMYCKEQNYKEAMYWYKKAAEKGNSTSMNKIGVMYYEGKGVEQDYQK AMYWYKKSSQEGNFTAMSNIGSMYYNGQGVTEDYKKAMYWYKKSYKEGNFGVMRDIGSMYYEGKGVIKDYKKAMQCYKKA SQIDNFIK >Mature_568_residues MDRFSFLKIEWPEIYQIICNVEEKSKEDSNITLIELAQIAELITKYILKENHIEKNTELLDEINLLKDCHNLNADIVDFF YKIIIVSNKAIYEDYSDSIIAKSFLDKMFEILVWFAIEYGKTDYRKVDLSNMIPEDKDIFNKYIKSKSYNYTEKNIENET MIQPFTIENEEFFKEENNDDINRYEQDVFETKEEFHKRIRNHEIFTLGRIFIEKSNINETDEIVAFPFSVYKSIQIKIPI IDMLYIERAEFENLSIEEEEYILFSKLDIINDKICIDINNIYIEVSNNKCKVHAVVLDISYYESYEKYRNIIYSKKPIPI GMIKFNKNKYDINKNEMPVTINYYDWIQKYILNTKAYIEIHRYEAKTLCKENLYYILNGKLDIFDKKLLIREYYIQSKSL NKNFRINLHSSDPMNKLRCLVDKEEILAMNIIGEMYCKEQNYKEAMYWYKKAAEKGNSTSMNKIGVMYYEGKGVEQDYQK AMYWYKKSSQEGNFTAMSNIGSMYYNGQGVTEDYKKAMYWYKKSYKEGNFGVMRDIGSMYYEGKGVIKDYKKAMQCYKKA SQIDNFIK
Specific function: Unknown
COG id: COG0790
COG function: function code R; FOG: TPR repeat, SEL1 subfamily
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: To E.coli ybeT [H]
Homologues:
Organism=Homo sapiens, GI19923669, Length=154, Percent_Identity=33.1168831168831, Blast_Score=88, Evalue=2e-17, Organism=Homo sapiens, GI151301150, Length=144, Percent_Identity=30.5555555555556, Blast_Score=87, Evalue=6e-17, Organism=Escherichia coli, GI87081769, Length=142, Percent_Identity=41.5492957746479, Blast_Score=110, Evalue=3e-25, Organism=Escherichia coli, GI1786867, Length=101, Percent_Identity=33.6633663366337, Blast_Score=74, Evalue=3e-14, Organism=Caenorhabditis elegans, GI17563256, Length=228, Percent_Identity=23.2456140350877, Blast_Score=67, Evalue=3e-11, Organism=Drosophila melanogaster, GI21355295, Length=194, Percent_Identity=24.2268041237113, Blast_Score=70, Evalue=3e-12,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR006597 - InterPro: IPR011990 [H]
Pfam domain/function: PF08238 Sel1 [H]
EC number: NA
Molecular weight: Translated: 68016; Mature: 68016
Theoretical pI: Translated: 5.43; Mature: 5.43
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.4 %Cys (Translated Protein) 3.5 %Met (Translated Protein) 4.9 %Cys+Met (Translated Protein) 1.4 %Cys (Mature Protein) 3.5 %Met (Mature Protein) 4.9 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MDRFSFLKIEWPEIYQIICNVEEKSKEDSNITLIELAQIAELITKYILKENHIEKNTELL CCCCEEEEECCHHHHHHHHCCHHHCCCCCCEEEEHHHHHHHHHHHHHHHHCCCCHHHHHH DEINLLKDCHNLNADIVDFFYKIIIVSNKAIYEDYSDSIIAKSFLDKMFEILVWFAIEYG HHHHHHHHHHCCCHHHHHHHHHHHHCCCCHHHCCCCHHHHHHHHHHHHHHHHHHHHHHCC KTDYRKVDLSNMIPEDKDIFNKYIKSKSYNYTEKNIENETMIQPFTIENEEFFKEENNDD CCCCEEECHHHCCCCCHHHHHHHHHCCCCCCHHHCCCCCCEECCEEECCHHHHHCCCCCH INRYEQDVFETKEEFHKRIRNHEIFTLGRIFIEKSNINETDEIVAFPFSVYKSIQIKIPI HHHHHHHHHHHHHHHHHHHCCCCEEEEEEEEEEECCCCCCHHEEEEEHHHCCEEEEEEEE IDMLYIERAEFENLSIEEEEYILFSKLDIINDKICIDINNIYIEVSNNKCKVHAVVLDIS EHEEHHHHHCCCCCCCCCCCEEEEEEHHHCCCEEEEEEEEEEEEECCCEEEEEEEEEEEH YYESYEKYRNIIYSKKPIPIGMIKFNKNKYDINKNEMPVTINYYDWIQKYILNTKAYIEI HHHHHHHHHHHHCCCCCCEEEEEEECCCEECCCCCCCCEEEEHHHHHHHHHHCCEEEEEE HRYEAKTLCKENLYYILNGKLDIFDKKLLIREYYIQSKSLNKNFRINLHSSDPMNKLRCL EEHHHHHHHHCCCEEEEECCEEEHHHHHHHHHHHHHCCCCCCCEEEEEECCCCHHHHHHH VDKEEILAMNIIGEMYCKEQNYKEAMYWYKKAAEKGNSTSMNKIGVMYYEGKGVEQDYQK CCHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHCCCCCCCCCEEEEEEEECCCCCHHHHH AMYWYKKSSQEGNFTAMSNIGSMYYNGQGVTEDYKKAMYWYKKSYKEGNFGVMRDIGSMY HHHHHHCCCCCCCEEEHHHCCCEEECCCCCCHHHHHHHHHHHHHCCCCCCHHHHHHHHHH YEGKGVIKDYKKAMQCYKKASQIDNFIK CCCCCHHHHHHHHHHHHHHHHHHHHHCC >Mature Secondary Structure MDRFSFLKIEWPEIYQIICNVEEKSKEDSNITLIELAQIAELITKYILKENHIEKNTELL CCCCEEEEECCHHHHHHHHCCHHHCCCCCCEEEEHHHHHHHHHHHHHHHHCCCCHHHHHH DEINLLKDCHNLNADIVDFFYKIIIVSNKAIYEDYSDSIIAKSFLDKMFEILVWFAIEYG HHHHHHHHHHCCCHHHHHHHHHHHHCCCCHHHCCCCHHHHHHHHHHHHHHHHHHHHHHCC KTDYRKVDLSNMIPEDKDIFNKYIKSKSYNYTEKNIENETMIQPFTIENEEFFKEENNDD CCCCEEECHHHCCCCCHHHHHHHHHCCCCCCHHHCCCCCCEECCEEECCHHHHHCCCCCH INRYEQDVFETKEEFHKRIRNHEIFTLGRIFIEKSNINETDEIVAFPFSVYKSIQIKIPI HHHHHHHHHHHHHHHHHHHCCCCEEEEEEEEEEECCCCCCHHEEEEEHHHCCEEEEEEEE IDMLYIERAEFENLSIEEEEYILFSKLDIINDKICIDINNIYIEVSNNKCKVHAVVLDIS EHEEHHHHHCCCCCCCCCCCEEEEEEHHHCCCEEEEEEEEEEEEECCCEEEEEEEEEEEH YYESYEKYRNIIYSKKPIPIGMIKFNKNKYDINKNEMPVTINYYDWIQKYILNTKAYIEI HHHHHHHHHHHHCCCCCCEEEEEEECCCEECCCCCCCCEEEEHHHHHHHHHHCCEEEEEE HRYEAKTLCKENLYYILNGKLDIFDKKLLIREYYIQSKSLNKNFRINLHSSDPMNKLRCL EEHHHHHHHHCCCEEEEECCEEEHHHHHHHHHHHHHCCCCCCCEEEEEECCCCHHHHHHH VDKEEILAMNIIGEMYCKEQNYKEAMYWYKKAAEKGNSTSMNKIGVMYYEGKGVEQDYQK CCHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHCCCCCCCCCEEEEEEEECCCCCHHHHH AMYWYKKSSQEGNFTAMSNIGSMYYNGQGVTEDYKKAMYWYKKSYKEGNFGVMRDIGSMY HHHHHHCCCCCCCEEEHHHCCCEEECCCCCCHHHHHHHHHHHHHCCCCCCHHHHHHHHHH YEGKGVIKDYKKAMQCYKKASQIDNFIK CCCCCHHHHHHHHHHHHHHHHHHHHHCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 8905232; 9278503 [H]