| Definition | Clostridium botulinum A2 str. Kyoto chromosome, complete genome. |
|---|---|
| Accession | NC_012563 |
| Length | 4,155,278 |
Click here to switch to the map view.
The map label for this gene is 226948467
Identifier: 226948467
GI number: 226948467
Start: 1415549
End: 1416877
Strand: Direct
Name: 226948467
Synonym: CLM_1353
Alternate gene names: NA
Gene position: 1415549-1416877 (Clockwise)
Preceding gene: 226948466
Following gene: 226948468
Centisome position: 34.07
GC content: 30.1
Gene sequence:
>1329_bases ATGAAATTTATACAGTATAAAACTACTAAAAAAGATAAATTCTTAAAAAACGAAATTAATAATACTACAGATGAAAGACC AACATTACATGTTTCACAAATTGAAAATAGGATCATAGAGGGATTTGGAAGTTGTTTTAATGAGCTGGGGATGAAAGCAT TAAATCACTTAGACAAAGATGAAAGAAATAAAGTATTTGATCAACTATTTTCTATTAAAGGTGATTGTCGTTTTAATCTT TGCAGAATGCCTATTGGAGCAAGTGATTATGCAACAGAATGGTATAGCTATAACGAAAATGAAAACGATTTTGATATGGA GAAATTTAGTATTCAAAAAGATAAAAGACTTCTTATACCTTATATAAAGGAAGCATTAAAAAGAAATCCTAATATAATTC TAACAGCTTCTCCATGGAGTCCTCCAACTTGGATGAAAACACAGAAGGCTTACAATTTTGGGACTCTACGCTTTGAAGAG AAAGTTTTAAAAGCATATGCTCTTTATTTTGTTAAATTTGTACAAGCATATGAGGAAGAAGGAATAACAATTCATCAAGT TCATGTTCAGAATGAAGTTGTTGCAGATCAAAAATTTCCGTCTTGTAGATGGACAGGAGATCAATTAAGGGATTTTATTA AAAATTATTTAGGACCAGCCTTTGAAAAGCATAATATTAAGAGTGAAATTTGGTTAGGGACAATTAATGCGCCAGAGCCC TATGTTGAATGGCTAGAAGATTATACACAAGATTTTGATGTTTATGCTGGCTTAGTATTGAGAGATCCAAAAGCATATAA GTATGTTAAAGGAGTAGGATATCAATGGGCAGGAAAAAATGCTATTCAGCGTTCAGTTGAAGCATTTCCAGAAAAAAGAT TTATCCAAACTGAAAATGAGTGCGGTAATGGTAAAAATACATGGATATATGCAGAATATGTTTTTAATCTATTCAGACAT TATATTGTAAATGGTGTAAATGGATATATGTATTGGAATGCTGTTTTAGAACCAAAAGGAATGAGTACTTGGGGATGGGA ACAGAATTCTATGATAACTGTAAATCCAGAAACTAAAGAAGTTATGTATAATCCAGAGTTCTATGTAATGAAACATTTTT CTCATTTTGTTCAAAAAGGGGCAAAAAGATTAACTACTTCAGGTGTAGATTCTGTTGATACAGTAGCTTTCAAGAATCCA GATGAATCTATAATTATTGTAATTTCAAATAAAAATGATGATTCTAGAATTGCTAATATTGAATTTACAGGTGAAATATT TGAAGTTGAATTAGAAGGACATTCATTTAACACTATTGTTTTAGAATAA
Upstream 100 bases:
>100_bases GGTGTACAAATTATTTTACTTAAATTTTATAAGTTAGATAAAATATACCCAAATATTATTAGCGATTTAGAAAATAGAAA GATATAGAAGGAGGAAGAAT
Downstream 100 bases:
>100_bases TTATTAAGAGGATGCCCGGATAAGGGCTTCCTTTTTCAAATAAGCTAAAAGAGGGAAAATAATATGGATAATAAGCATTA TTTAAGTATAGATATTGGAG
Product: O-glycosyl hydrolase, family 30
Products: D-glucose; N-acylsphingosine
Alternate protein names: Glucan Endo-1 6-Beta-Glucosidase; Glycoside Hydrolase Family; O-Glycosyl Hydrolase Family; Glycoside Hydrolase Family Protein; O-Glycosyl Hydrolase; Glycosyl Hydrolase; Ricin B Lectin; O-Glycosyl Hydrolase Family Protein; Glycoside Hydrolase; Lysosomal Glucosyl Ceramidase-Like Protein; LPXTG-Motif Cell Wall Anchor Domain Protein; Cellulosome Protein Dockerin Type I; Glycosy Hydrolase Family Protein; Glucan EndO-1 6-Beta-Glucosidase; Beta-Glycosidase; Helix-Turn-Helix AraC Type; Glycosyl Hydrolase Family; Glycosyl Hydrolases Family; Endo-1 6-Beta-D-Glucanase; Glucuronoarabinoxylan Endo-1 4-Beta-Xylanase
Number of amino acids: Translated: 442; Mature: 442
Protein sequence:
>442_residues MKFIQYKTTKKDKFLKNEINNTTDERPTLHVSQIENRIIEGFGSCFNELGMKALNHLDKDERNKVFDQLFSIKGDCRFNL CRMPIGASDYATEWYSYNENENDFDMEKFSIQKDKRLLIPYIKEALKRNPNIILTASPWSPPTWMKTQKAYNFGTLRFEE KVLKAYALYFVKFVQAYEEEGITIHQVHVQNEVVADQKFPSCRWTGDQLRDFIKNYLGPAFEKHNIKSEIWLGTINAPEP YVEWLEDYTQDFDVYAGLVLRDPKAYKYVKGVGYQWAGKNAIQRSVEAFPEKRFIQTENECGNGKNTWIYAEYVFNLFRH YIVNGVNGYMYWNAVLEPKGMSTWGWEQNSMITVNPETKEVMYNPEFYVMKHFSHFVQKGAKRLTTSGVDSVDTVAFKNP DESIIIVISNKNDDSRIANIEFTGEIFEVELEGHSFNTIVLE
Sequences:
>Translated_442_residues MKFIQYKTTKKDKFLKNEINNTTDERPTLHVSQIENRIIEGFGSCFNELGMKALNHLDKDERNKVFDQLFSIKGDCRFNL CRMPIGASDYATEWYSYNENENDFDMEKFSIQKDKRLLIPYIKEALKRNPNIILTASPWSPPTWMKTQKAYNFGTLRFEE KVLKAYALYFVKFVQAYEEEGITIHQVHVQNEVVADQKFPSCRWTGDQLRDFIKNYLGPAFEKHNIKSEIWLGTINAPEP YVEWLEDYTQDFDVYAGLVLRDPKAYKYVKGVGYQWAGKNAIQRSVEAFPEKRFIQTENECGNGKNTWIYAEYVFNLFRH YIVNGVNGYMYWNAVLEPKGMSTWGWEQNSMITVNPETKEVMYNPEFYVMKHFSHFVQKGAKRLTTSGVDSVDTVAFKNP DESIIIVISNKNDDSRIANIEFTGEIFEVELEGHSFNTIVLE >Mature_442_residues MKFIQYKTTKKDKFLKNEINNTTDERPTLHVSQIENRIIEGFGSCFNELGMKALNHLDKDERNKVFDQLFSIKGDCRFNL CRMPIGASDYATEWYSYNENENDFDMEKFSIQKDKRLLIPYIKEALKRNPNIILTASPWSPPTWMKTQKAYNFGTLRFEE KVLKAYALYFVKFVQAYEEEGITIHQVHVQNEVVADQKFPSCRWTGDQLRDFIKNYLGPAFEKHNIKSEIWLGTINAPEP YVEWLEDYTQDFDVYAGLVLRDPKAYKYVKGVGYQWAGKNAIQRSVEAFPEKRFIQTENECGNGKNTWIYAEYVFNLFRH YIVNGVNGYMYWNAVLEPKGMSTWGWEQNSMITVNPETKEVMYNPEFYVMKHFSHFVQKGAKRLTTSGVDSVDTVAFKNP DESIIIVISNKNDDSRIANIEFTGEIFEVELEGHSFNTIVLE
Specific function: Unknown
COG id: COG5520
COG function: function code M; O-Glycosyl hydrolase
Gene ontology:
Cell location: Cytoplasmic
Metaboloic importance: NA
Operon status: Not Known
Operon components: None
Similarity: NA
Homologues:
Organism=Homo sapiens, GI284807150, Length=409, Percent_Identity=28.361858190709, Blast_Score=152, Evalue=7e-37, Organism=Homo sapiens, GI54607043, Length=410, Percent_Identity=28.2926829268293, Blast_Score=152, Evalue=9e-37, Organism=Homo sapiens, GI54607045, Length=410, Percent_Identity=28.2926829268293, Blast_Score=152, Evalue=9e-37, Organism=Homo sapiens, GI54607047, Length=410, Percent_Identity=28.2926829268293, Blast_Score=152, Evalue=9e-37, Organism=Homo sapiens, GI284807152, Length=371, Percent_Identity=29.1105121293801, Blast_Score=143, Evalue=4e-34, Organism=Caenorhabditis elegans, GI115532470, Length=434, Percent_Identity=31.7972350230415, Blast_Score=169, Evalue=2e-42, Organism=Caenorhabditis elegans, GI115532472, Length=434, Percent_Identity=31.7972350230415, Blast_Score=169, Evalue=2e-42, Organism=Caenorhabditis elegans, GI17539758, Length=454, Percent_Identity=29.0748898678414, Blast_Score=167, Evalue=9e-42, Organism=Caenorhabditis elegans, GI17539756, Length=459, Percent_Identity=29.6296296296296, Blast_Score=165, Evalue=5e-41, Organism=Caenorhabditis elegans, GI25151335, Length=386, Percent_Identity=31.0880829015544, Blast_Score=155, Evalue=5e-38, Organism=Caenorhabditis elegans, GI17542884, Length=472, Percent_Identity=27.3305084745763, Blast_Score=154, Evalue=1e-37, Organism=Caenorhabditis elegans, GI193204210, Length=435, Percent_Identity=27.5862068965517, Blast_Score=149, Evalue=3e-36, Organism=Drosophila melanogaster, GI21355305, Length=431, Percent_Identity=24.3619489559165, Blast_Score=104, Evalue=9e-23, Organism=Drosophila melanogaster, GI161078544, Length=427, Percent_Identity=23.4192037470726, Blast_Score=95, Evalue=1e-19,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
NA
Pfam domain/function: NA
EC number: 3.2.1.45
Molecular weight: Translated: 51705; Mature: 51705
Theoretical pI: Translated: 5.90; Mature: 5.90
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.1 %Cys (Translated Protein) 2.3 %Met (Translated Protein) 3.4 %Cys+Met (Translated Protein) 1.1 %Cys (Mature Protein) 2.3 %Met (Mature Protein) 3.4 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MKFIQYKTTKKDKFLKNEINNTTDERPTLHVSQIENRIIEGFGSCFNELGMKALNHLDKD CCCEEECCCCHHHHHHHHHCCCCCCCCCEEHHHHHHHHHHHHHHHHHHHHHHHHHHCCHH ERNKVFDQLFSIKGDCRFNLCRMPIGASDYATEWYSYNENENDFDMEKFSIQKDKRLLIP HHHHHHHHHHCCCCCCEEEEEECCCCCCHHHHHCCCCCCCCCCCCHHHHHHCCCCEEECH YIKEALKRNPNIILTASPWSPPTWMKTQKAYNFGTLRFEEKVLKAYALYFVKFVQAYEEE HHHHHHHCCCCEEEEECCCCCCCCHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHC GITIHQVHVQNEVVADQKFPSCRWTGDQLRDFIKNYLGPAFEKHNIKSEIWLGTINAPEP CCEEEEEEECCHHHCCCCCCCCCCCHHHHHHHHHHHCCCCHHHCCCCCEEEEEECCCCHH YVEWLEDYTQDFDVYAGLVLRDPKAYKYVKGVGYQWAGKNAIQRSVEAFPEKRFIQTENE HHHHHHHHHHCHHHHCCEEEECCHHHHHHHCCCCCCCCCHHHHHHHHHCCCHHCCCCCCC CGNGKNTWIYAEYVFNLFRHYIVNGVNGYMYWNAVLEPKGMSTWGWEQNSMITVNPETKE CCCCCCCEEEHHHHHHHHHHHHHCCCCCEEEEEEEECCCCCCCCCCCCCCEEEECCCCCE VMYNPEFYVMKHFSHFVQKGAKRLTTSGVDSVDTVAFKNPDESIIIVISNKNDDSRIANI EEECCCHHHHHHHHHHHHHHHHHHHCCCCCCCCEEEECCCCCEEEEEEECCCCCCEEEEE EFTGEIFEVELEGHSFNTIVLE EEECEEEEEEECCCCCEEEEEC >Mature Secondary Structure MKFIQYKTTKKDKFLKNEINNTTDERPTLHVSQIENRIIEGFGSCFNELGMKALNHLDKD CCCEEECCCCHHHHHHHHHCCCCCCCCCEEHHHHHHHHHHHHHHHHHHHHHHHHHHCCHH ERNKVFDQLFSIKGDCRFNLCRMPIGASDYATEWYSYNENENDFDMEKFSIQKDKRLLIP HHHHHHHHHHCCCCCCEEEEEECCCCCCHHHHHCCCCCCCCCCCCHHHHHHCCCCEEECH YIKEALKRNPNIILTASPWSPPTWMKTQKAYNFGTLRFEEKVLKAYALYFVKFVQAYEEE HHHHHHHCCCCEEEEECCCCCCCCHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHC GITIHQVHVQNEVVADQKFPSCRWTGDQLRDFIKNYLGPAFEKHNIKSEIWLGTINAPEP CCEEEEEEECCHHHCCCCCCCCCCCHHHHHHHHHHHCCCCHHHCCCCCEEEEEECCCCHH YVEWLEDYTQDFDVYAGLVLRDPKAYKYVKGVGYQWAGKNAIQRSVEAFPEKRFIQTENE HHHHHHHHHHCHHHHCCEEEECCHHHHHHHCCCCCCCCCHHHHHHHHHCCCHHCCCCCCC CGNGKNTWIYAEYVFNLFRHYIVNGVNGYMYWNAVLEPKGMSTWGWEQNSMITVNPETKE CCCCCCCEEEHHHHHHHHHHHHHCCCCCEEEEEEEECCCCCCCCCCCCCCEEEECCCCCE VMYNPEFYVMKHFSHFVQKGAKRLTTSGVDSVDTVAFKNPDESIIIVISNKNDDSRIANI EEECCCHHHHHHHHHHHHHHHHHHHCCCCCCCCEEEECCCCCEEEEEEECCCCCCEEEEE EFTGEIFEVELEGHSFNTIVLE EEECEEEEEEECCCCCEEEEEC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: D-glucosyl-N-acylsphingosine; H2O
Specific reaction: D-glucosyl-N-acylsphingosine + H2O = D-glucose + N-acylsphingosine
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: NA