The gene/protein map for NC_012563 is currently unavailable.
Definition Clostridium botulinum A2 str. Kyoto chromosome, complete genome.
Accession NC_012563
Length 4,155,278

Click here to switch to the map view.

The map label for this gene is 226948467

Identifier: 226948467

GI number: 226948467

Start: 1415549

End: 1416877

Strand: Direct

Name: 226948467

Synonym: CLM_1353

Alternate gene names: NA

Gene position: 1415549-1416877 (Clockwise)

Preceding gene: 226948466

Following gene: 226948468

Centisome position: 34.07

GC content: 30.1

Gene sequence:

>1329_bases
ATGAAATTTATACAGTATAAAACTACTAAAAAAGATAAATTCTTAAAAAACGAAATTAATAATACTACAGATGAAAGACC
AACATTACATGTTTCACAAATTGAAAATAGGATCATAGAGGGATTTGGAAGTTGTTTTAATGAGCTGGGGATGAAAGCAT
TAAATCACTTAGACAAAGATGAAAGAAATAAAGTATTTGATCAACTATTTTCTATTAAAGGTGATTGTCGTTTTAATCTT
TGCAGAATGCCTATTGGAGCAAGTGATTATGCAACAGAATGGTATAGCTATAACGAAAATGAAAACGATTTTGATATGGA
GAAATTTAGTATTCAAAAAGATAAAAGACTTCTTATACCTTATATAAAGGAAGCATTAAAAAGAAATCCTAATATAATTC
TAACAGCTTCTCCATGGAGTCCTCCAACTTGGATGAAAACACAGAAGGCTTACAATTTTGGGACTCTACGCTTTGAAGAG
AAAGTTTTAAAAGCATATGCTCTTTATTTTGTTAAATTTGTACAAGCATATGAGGAAGAAGGAATAACAATTCATCAAGT
TCATGTTCAGAATGAAGTTGTTGCAGATCAAAAATTTCCGTCTTGTAGATGGACAGGAGATCAATTAAGGGATTTTATTA
AAAATTATTTAGGACCAGCCTTTGAAAAGCATAATATTAAGAGTGAAATTTGGTTAGGGACAATTAATGCGCCAGAGCCC
TATGTTGAATGGCTAGAAGATTATACACAAGATTTTGATGTTTATGCTGGCTTAGTATTGAGAGATCCAAAAGCATATAA
GTATGTTAAAGGAGTAGGATATCAATGGGCAGGAAAAAATGCTATTCAGCGTTCAGTTGAAGCATTTCCAGAAAAAAGAT
TTATCCAAACTGAAAATGAGTGCGGTAATGGTAAAAATACATGGATATATGCAGAATATGTTTTTAATCTATTCAGACAT
TATATTGTAAATGGTGTAAATGGATATATGTATTGGAATGCTGTTTTAGAACCAAAAGGAATGAGTACTTGGGGATGGGA
ACAGAATTCTATGATAACTGTAAATCCAGAAACTAAAGAAGTTATGTATAATCCAGAGTTCTATGTAATGAAACATTTTT
CTCATTTTGTTCAAAAAGGGGCAAAAAGATTAACTACTTCAGGTGTAGATTCTGTTGATACAGTAGCTTTCAAGAATCCA
GATGAATCTATAATTATTGTAATTTCAAATAAAAATGATGATTCTAGAATTGCTAATATTGAATTTACAGGTGAAATATT
TGAAGTTGAATTAGAAGGACATTCATTTAACACTATTGTTTTAGAATAA

Upstream 100 bases:

>100_bases
GGTGTACAAATTATTTTACTTAAATTTTATAAGTTAGATAAAATATACCCAAATATTATTAGCGATTTAGAAAATAGAAA
GATATAGAAGGAGGAAGAAT

Downstream 100 bases:

>100_bases
TTATTAAGAGGATGCCCGGATAAGGGCTTCCTTTTTCAAATAAGCTAAAAGAGGGAAAATAATATGGATAATAAGCATTA
TTTAAGTATAGATATTGGAG

Product: O-glycosyl hydrolase, family 30

Products: D-glucose; N-acylsphingosine

Alternate protein names: Glucan Endo-1 6-Beta-Glucosidase; Glycoside Hydrolase Family; O-Glycosyl Hydrolase Family; Glycoside Hydrolase Family Protein; O-Glycosyl Hydrolase; Glycosyl Hydrolase; Ricin B Lectin; O-Glycosyl Hydrolase Family Protein; Glycoside Hydrolase; Lysosomal Glucosyl Ceramidase-Like Protein; LPXTG-Motif Cell Wall Anchor Domain Protein; Cellulosome Protein Dockerin Type I; Glycosy Hydrolase Family Protein; Glucan EndO-1 6-Beta-Glucosidase; Beta-Glycosidase; Helix-Turn-Helix AraC Type; Glycosyl Hydrolase Family; Glycosyl Hydrolases Family; Endo-1 6-Beta-D-Glucanase; Glucuronoarabinoxylan Endo-1 4-Beta-Xylanase

Number of amino acids: Translated: 442; Mature: 442

Protein sequence:

>442_residues
MKFIQYKTTKKDKFLKNEINNTTDERPTLHVSQIENRIIEGFGSCFNELGMKALNHLDKDERNKVFDQLFSIKGDCRFNL
CRMPIGASDYATEWYSYNENENDFDMEKFSIQKDKRLLIPYIKEALKRNPNIILTASPWSPPTWMKTQKAYNFGTLRFEE
KVLKAYALYFVKFVQAYEEEGITIHQVHVQNEVVADQKFPSCRWTGDQLRDFIKNYLGPAFEKHNIKSEIWLGTINAPEP
YVEWLEDYTQDFDVYAGLVLRDPKAYKYVKGVGYQWAGKNAIQRSVEAFPEKRFIQTENECGNGKNTWIYAEYVFNLFRH
YIVNGVNGYMYWNAVLEPKGMSTWGWEQNSMITVNPETKEVMYNPEFYVMKHFSHFVQKGAKRLTTSGVDSVDTVAFKNP
DESIIIVISNKNDDSRIANIEFTGEIFEVELEGHSFNTIVLE

Sequences:

>Translated_442_residues
MKFIQYKTTKKDKFLKNEINNTTDERPTLHVSQIENRIIEGFGSCFNELGMKALNHLDKDERNKVFDQLFSIKGDCRFNL
CRMPIGASDYATEWYSYNENENDFDMEKFSIQKDKRLLIPYIKEALKRNPNIILTASPWSPPTWMKTQKAYNFGTLRFEE
KVLKAYALYFVKFVQAYEEEGITIHQVHVQNEVVADQKFPSCRWTGDQLRDFIKNYLGPAFEKHNIKSEIWLGTINAPEP
YVEWLEDYTQDFDVYAGLVLRDPKAYKYVKGVGYQWAGKNAIQRSVEAFPEKRFIQTENECGNGKNTWIYAEYVFNLFRH
YIVNGVNGYMYWNAVLEPKGMSTWGWEQNSMITVNPETKEVMYNPEFYVMKHFSHFVQKGAKRLTTSGVDSVDTVAFKNP
DESIIIVISNKNDDSRIANIEFTGEIFEVELEGHSFNTIVLE
>Mature_442_residues
MKFIQYKTTKKDKFLKNEINNTTDERPTLHVSQIENRIIEGFGSCFNELGMKALNHLDKDERNKVFDQLFSIKGDCRFNL
CRMPIGASDYATEWYSYNENENDFDMEKFSIQKDKRLLIPYIKEALKRNPNIILTASPWSPPTWMKTQKAYNFGTLRFEE
KVLKAYALYFVKFVQAYEEEGITIHQVHVQNEVVADQKFPSCRWTGDQLRDFIKNYLGPAFEKHNIKSEIWLGTINAPEP
YVEWLEDYTQDFDVYAGLVLRDPKAYKYVKGVGYQWAGKNAIQRSVEAFPEKRFIQTENECGNGKNTWIYAEYVFNLFRH
YIVNGVNGYMYWNAVLEPKGMSTWGWEQNSMITVNPETKEVMYNPEFYVMKHFSHFVQKGAKRLTTSGVDSVDTVAFKNP
DESIIIVISNKNDDSRIANIEFTGEIFEVELEGHSFNTIVLE

Specific function: Unknown

COG id: COG5520

COG function: function code M; O-Glycosyl hydrolase

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

Organism=Homo sapiens, GI284807150, Length=409, Percent_Identity=28.361858190709, Blast_Score=152, Evalue=7e-37,
Organism=Homo sapiens, GI54607043, Length=410, Percent_Identity=28.2926829268293, Blast_Score=152, Evalue=9e-37,
Organism=Homo sapiens, GI54607045, Length=410, Percent_Identity=28.2926829268293, Blast_Score=152, Evalue=9e-37,
Organism=Homo sapiens, GI54607047, Length=410, Percent_Identity=28.2926829268293, Blast_Score=152, Evalue=9e-37,
Organism=Homo sapiens, GI284807152, Length=371, Percent_Identity=29.1105121293801, Blast_Score=143, Evalue=4e-34,
Organism=Caenorhabditis elegans, GI115532470, Length=434, Percent_Identity=31.7972350230415, Blast_Score=169, Evalue=2e-42,
Organism=Caenorhabditis elegans, GI115532472, Length=434, Percent_Identity=31.7972350230415, Blast_Score=169, Evalue=2e-42,
Organism=Caenorhabditis elegans, GI17539758, Length=454, Percent_Identity=29.0748898678414, Blast_Score=167, Evalue=9e-42,
Organism=Caenorhabditis elegans, GI17539756, Length=459, Percent_Identity=29.6296296296296, Blast_Score=165, Evalue=5e-41,
Organism=Caenorhabditis elegans, GI25151335, Length=386, Percent_Identity=31.0880829015544, Blast_Score=155, Evalue=5e-38,
Organism=Caenorhabditis elegans, GI17542884, Length=472, Percent_Identity=27.3305084745763, Blast_Score=154, Evalue=1e-37,
Organism=Caenorhabditis elegans, GI193204210, Length=435, Percent_Identity=27.5862068965517, Blast_Score=149, Evalue=3e-36,
Organism=Drosophila melanogaster, GI21355305, Length=431, Percent_Identity=24.3619489559165, Blast_Score=104, Evalue=9e-23,
Organism=Drosophila melanogaster, GI161078544, Length=427, Percent_Identity=23.4192037470726, Blast_Score=95, Evalue=1e-19,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: 3.2.1.45

Molecular weight: Translated: 51705; Mature: 51705

Theoretical pI: Translated: 5.90; Mature: 5.90

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.1 %Cys     (Translated Protein)
2.3 %Met     (Translated Protein)
3.4 %Cys+Met (Translated Protein)
1.1 %Cys     (Mature Protein)
2.3 %Met     (Mature Protein)
3.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKFIQYKTTKKDKFLKNEINNTTDERPTLHVSQIENRIIEGFGSCFNELGMKALNHLDKD
CCCEEECCCCHHHHHHHHHCCCCCCCCCEEHHHHHHHHHHHHHHHHHHHHHHHHHHCCHH
ERNKVFDQLFSIKGDCRFNLCRMPIGASDYATEWYSYNENENDFDMEKFSIQKDKRLLIP
HHHHHHHHHHCCCCCCEEEEEECCCCCCHHHHHCCCCCCCCCCCCHHHHHHCCCCEEECH
YIKEALKRNPNIILTASPWSPPTWMKTQKAYNFGTLRFEEKVLKAYALYFVKFVQAYEEE
HHHHHHHCCCCEEEEECCCCCCCCHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHC
GITIHQVHVQNEVVADQKFPSCRWTGDQLRDFIKNYLGPAFEKHNIKSEIWLGTINAPEP
CCEEEEEEECCHHHCCCCCCCCCCCHHHHHHHHHHHCCCCHHHCCCCCEEEEEECCCCHH
YVEWLEDYTQDFDVYAGLVLRDPKAYKYVKGVGYQWAGKNAIQRSVEAFPEKRFIQTENE
HHHHHHHHHHCHHHHCCEEEECCHHHHHHHCCCCCCCCCHHHHHHHHHCCCHHCCCCCCC
CGNGKNTWIYAEYVFNLFRHYIVNGVNGYMYWNAVLEPKGMSTWGWEQNSMITVNPETKE
CCCCCCCEEEHHHHHHHHHHHHHCCCCCEEEEEEEECCCCCCCCCCCCCCEEEECCCCCE
VMYNPEFYVMKHFSHFVQKGAKRLTTSGVDSVDTVAFKNPDESIIIVISNKNDDSRIANI
EEECCCHHHHHHHHHHHHHHHHHHHCCCCCCCCEEEECCCCCEEEEEEECCCCCCEEEEE
EFTGEIFEVELEGHSFNTIVLE
EEECEEEEEEECCCCCEEEEEC
>Mature Secondary Structure
MKFIQYKTTKKDKFLKNEINNTTDERPTLHVSQIENRIIEGFGSCFNELGMKALNHLDKD
CCCEEECCCCHHHHHHHHHCCCCCCCCCEEHHHHHHHHHHHHHHHHHHHHHHHHHHCCHH
ERNKVFDQLFSIKGDCRFNLCRMPIGASDYATEWYSYNENENDFDMEKFSIQKDKRLLIP
HHHHHHHHHHCCCCCCEEEEEECCCCCCHHHHHCCCCCCCCCCCCHHHHHHCCCCEEECH
YIKEALKRNPNIILTASPWSPPTWMKTQKAYNFGTLRFEEKVLKAYALYFVKFVQAYEEE
HHHHHHHCCCCEEEEECCCCCCCCHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHC
GITIHQVHVQNEVVADQKFPSCRWTGDQLRDFIKNYLGPAFEKHNIKSEIWLGTINAPEP
CCEEEEEEECCHHHCCCCCCCCCCCHHHHHHHHHHHCCCCHHHCCCCCEEEEEECCCCHH
YVEWLEDYTQDFDVYAGLVLRDPKAYKYVKGVGYQWAGKNAIQRSVEAFPEKRFIQTENE
HHHHHHHHHHCHHHHCCEEEECCHHHHHHHCCCCCCCCCHHHHHHHHHCCCHHCCCCCCC
CGNGKNTWIYAEYVFNLFRHYIVNGVNGYMYWNAVLEPKGMSTWGWEQNSMITVNPETKE
CCCCCCCEEEHHHHHHHHHHHHHCCCCCEEEEEEEECCCCCCCCCCCCCCEEEECCCCCE
VMYNPEFYVMKHFSHFVQKGAKRLTTSGVDSVDTVAFKNPDESIIIVISNKNDDSRIANI
EEECCCHHHHHHHHHHHHHHHHHHHCCCCCCCCEEEECCCCCEEEEEEECCCCCCEEEEE
EFTGEIFEVELEGHSFNTIVLE
EEECEEEEEEECCCCCEEEEEC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: D-glucosyl-N-acylsphingosine; H2O

Specific reaction: D-glucosyl-N-acylsphingosine + H2O = D-glucose + N-acylsphingosine

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA