| Definition | Clostridium perfringens str. 13, complete genome. |
|---|---|
| Accession | NC_003366 |
| Length | 3,031,430 |
Click here to switch to the map view.
The map label for this gene is exo I [H]
Identifier: 18309963
GI number: 18309963
Start: 1181316
End: 1183148
Strand: Direct
Name: exo I [H]
Synonym: CPE0981
Alternate gene names: 18309963
Gene position: 1181316-1183148 (Clockwise)
Preceding gene: 18309958
Following gene: 18309964
Centisome position: 38.97
GC content: 29.24
Gene sequence:
>1833_bases ATGCATTTAATACCAAGACCAAAAAGTGTAATTAATCATGAAGGTGAATTTTTTATAGAAAGAGATACTGAAATTATATT AAGTAGTGAATTATCCTTTGAAGATTTAAATTTAGCAATTATGATTCAAAAGGAAATAGAAAGAGTATTAGATTTTAAAC TTAACATAAATAAACTTTTTATGGATAAGAAATATAGTAACTCAATAATTTTAAGAGAATGCAAATTTGAAAATGAAGAG GAATATAAAATAGAAATAAAGGAGAATAAGGCAATAATAGAAGGGTCTGGTGCTGGATTATTTTATGGATGTCAGAGTTT TAGACAACTTGTAAGAGAGTTTGGAGCATGTATTCCAAATCTAACAATAGAAGATTCTCCATATTTTAAATATCGTGGAT TTTATCACGATGTAACAAGGGGAATGGTACCAACCTTAGATACATTAAAAAGCTTAGTTGATAAGGCAGCTTTTTATAAA ATAAATCAGTTGCAACTATATATAGAGCATACCTTTGCTTTTAAGGGAATGAGCGAAGTTTGGATGGATAAGGATCCTTT AACAGCAGAGGAAATATTGATTTTAGACAAGTATTGCAAAGAGAGACATGTGGAACTTGTACCATCATTATCAACTTTTG GTCATCTATATGAAGCTTTAAGAAGTAAATCCTTTAGAGAACTTTGTGAATTAGAAATAGGAGATGAAGAATATTCTTTT GTAGATAGAATGGCACATCATACTTTAGATGTTACTAACCCTAAAAGTTTAGACTTTGTTGAATCAATGCTTTTAGAATT TATTCCTTTATTCAGTTCAGATAAGTTTAATATTTGCTGTGATGAAACCTTTGATTTAGGAAAAGGAAAGAGTAGAGAGA AAGCTGAAAAATTAGGAGTAGGTAAAATATATACAGAGTTTTTAAATAAGGTATATAACATTGTAAAAAGTTTTAATAAA AATGTTATGTTCTGGGGAGATATAATAGTTGGATATCCAGAGCTTTTAAGTGATATACCAGAGGATTTAACTTGTTTAAC TTGGAACTATCATCCACAGGCTAATGATGTAGCTACAAAAATTATAGCAGAGCATAATAAAGTACAATATGTTTGCCCTG GTGTAGGTGGATGGAATATGATGATGAATCTTATAGAAGGTTCTTTTAGTAATATAAGAAGAATGGTTAACCACGGAATA AAATATGGAGCTATAGGTGTTTTAAATACAAACTGGGGAGACTATGGAAATATAAATCTATTAGCTAATTCAATACCATC TATGATTTATGGAGCAGGAATTTCATGGAATCCAAAGGAAGAGGAGTTTAATGAAATCTTTAAGTCTATATCCCTTATGG AATTTGGTGATGAATCTATGAATGTAGTTTCTTTAATGGATAAGCTTTCTAAAAATCAAGTTGCAGGTTGGGGAGAGCTT GTTAGATGGAAAGAAAAGTTTAATGAAAGAGAAGAAACCAAGGAAGAAATTAAGAATATAGATACTTTAAAAGTTTTTGA GGGATATAAGGTTGCTTCAGAGGTAAGAAGAGAGTTTATTAAATTACTTAAAAATACAGAGGATAAAGAAGCTATTCAAA GCTTTGTTGTGTCTTCAAAGGGATGGGAGCTTATAGATAAATTCTTTATGGTATTACTTGAAAGAGAGTTTAATAAAAAA AGTTTATTAGATATAGATAAAAAAGACTTAGCTAAGGATTTAGAGCTTTGGTTTTATGATTACACATCAATATGGAGAAA ATATAATAAAGAAAGCGAGCTTAATAGAATAAGAGAAGTTATAGTATATATGTGCTCATATTTAAGGGGTTAA
Upstream 100 bases:
>100_bases AATAAAATTATTTTATATAATAATAGTAAACATTTAAATTGTTTATTACCATTATGAGCAAATTTTTGTAGAAAGTAAAG TATTATTAGGGGGAAGAGAA
Downstream 100 bases:
>100_bases GAGGATTTTTAAAGGCTAAACAAATATAAAATTAAAGAGTATAATAAATTATAAAGTAATATTTACTTTGTTGATAACTT TATTTTTATACTAATAGAAT
Product: glycosyl hydrolase, family 20
Products: NA
Alternate protein names: Beta-N-acetylhexosaminidase; N-acetyl-beta-glucosaminidase [H]
Number of amino acids: Translated: 610; Mature: 610
Protein sequence:
>610_residues MHLIPRPKSVINHEGEFFIERDTEIILSSELSFEDLNLAIMIQKEIERVLDFKLNINKLFMDKKYSNSIILRECKFENEE EYKIEIKENKAIIEGSGAGLFYGCQSFRQLVREFGACIPNLTIEDSPYFKYRGFYHDVTRGMVPTLDTLKSLVDKAAFYK INQLQLYIEHTFAFKGMSEVWMDKDPLTAEEILILDKYCKERHVELVPSLSTFGHLYEALRSKSFRELCELEIGDEEYSF VDRMAHHTLDVTNPKSLDFVESMLLEFIPLFSSDKFNICCDETFDLGKGKSREKAEKLGVGKIYTEFLNKVYNIVKSFNK NVMFWGDIIVGYPELLSDIPEDLTCLTWNYHPQANDVATKIIAEHNKVQYVCPGVGGWNMMMNLIEGSFSNIRRMVNHGI KYGAIGVLNTNWGDYGNINLLANSIPSMIYGAGISWNPKEEEFNEIFKSISLMEFGDESMNVVSLMDKLSKNQVAGWGEL VRWKEKFNEREETKEEIKNIDTLKVFEGYKVASEVRREFIKLLKNTEDKEAIQSFVVSSKGWELIDKFFMVLLEREFNKK SLLDIDKKDLAKDLELWFYDYTSIWRKYNKESELNRIREVIVYMCSYLRG
Sequences:
>Translated_610_residues MHLIPRPKSVINHEGEFFIERDTEIILSSELSFEDLNLAIMIQKEIERVLDFKLNINKLFMDKKYSNSIILRECKFENEE EYKIEIKENKAIIEGSGAGLFYGCQSFRQLVREFGACIPNLTIEDSPYFKYRGFYHDVTRGMVPTLDTLKSLVDKAAFYK INQLQLYIEHTFAFKGMSEVWMDKDPLTAEEILILDKYCKERHVELVPSLSTFGHLYEALRSKSFRELCELEIGDEEYSF VDRMAHHTLDVTNPKSLDFVESMLLEFIPLFSSDKFNICCDETFDLGKGKSREKAEKLGVGKIYTEFLNKVYNIVKSFNK NVMFWGDIIVGYPELLSDIPEDLTCLTWNYHPQANDVATKIIAEHNKVQYVCPGVGGWNMMMNLIEGSFSNIRRMVNHGI KYGAIGVLNTNWGDYGNINLLANSIPSMIYGAGISWNPKEEEFNEIFKSISLMEFGDESMNVVSLMDKLSKNQVAGWGEL VRWKEKFNEREETKEEIKNIDTLKVFEGYKVASEVRREFIKLLKNTEDKEAIQSFVVSSKGWELIDKFFMVLLEREFNKK SLLDIDKKDLAKDLELWFYDYTSIWRKYNKESELNRIREVIVYMCSYLRG >Mature_610_residues MHLIPRPKSVINHEGEFFIERDTEIILSSELSFEDLNLAIMIQKEIERVLDFKLNINKLFMDKKYSNSIILRECKFENEE EYKIEIKENKAIIEGSGAGLFYGCQSFRQLVREFGACIPNLTIEDSPYFKYRGFYHDVTRGMVPTLDTLKSLVDKAAFYK INQLQLYIEHTFAFKGMSEVWMDKDPLTAEEILILDKYCKERHVELVPSLSTFGHLYEALRSKSFRELCELEIGDEEYSF VDRMAHHTLDVTNPKSLDFVESMLLEFIPLFSSDKFNICCDETFDLGKGKSREKAEKLGVGKIYTEFLNKVYNIVKSFNK NVMFWGDIIVGYPELLSDIPEDLTCLTWNYHPQANDVATKIIAEHNKVQYVCPGVGGWNMMMNLIEGSFSNIRRMVNHGI KYGAIGVLNTNWGDYGNINLLANSIPSMIYGAGISWNPKEEEFNEIFKSISLMEFGDESMNVVSLMDKLSKNQVAGWGEL VRWKEKFNEREETKEEIKNIDTLKVFEGYKVASEVRREFIKLLKNTEDKEAIQSFVVSSKGWELIDKFFMVLLEREFNKK SLLDIDKKDLAKDLELWFYDYTSIWRKYNKESELNRIREVIVYMCSYLRG
Specific function: Hydrolyzes rapidly p-nitrophenyl-N-acetyl-beta-D- glucosaminide (PNP-beta-GlcNAc) and 4-methylumbelliferyl-beta- GlcNAc, and slightly active on p-nitrophenyl-beta-GalNAc. Hydrolyzes aryl-N-acetyl-beta-D-glucosaminide (aryl-beta-GlcNAc), aryl-beta-GalNAc a
COG id: COG3525
COG function: function code G; N-acetyl-beta-hexosaminidase
Gene ontology:
Cell location: Periplasm [H]
Metaboloic importance: NA
Operon status: Not Known
Operon components: None
Similarity: Belongs to the glycosyl hydrolase 20 family [H]
Homologues:
None
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR015882 - InterPro: IPR001540 - InterPro: IPR015883 - InterPro: IPR017853 - InterPro: IPR013781 [H]
Pfam domain/function: PF00728 Glyco_hydro_20; PF02838 Glyco_hydro_20b [H]
EC number: =3.2.1.52 [H]
Molecular weight: Translated: 71146; Mature: 71146
Theoretical pI: Translated: 5.02; Mature: 5.02
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.6 %Cys (Translated Protein) 3.1 %Met (Translated Protein) 4.8 %Cys+Met (Translated Protein) 1.6 %Cys (Mature Protein) 3.1 %Met (Mature Protein) 4.8 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MHLIPRPKSVINHEGEFFIERDTEIILSSELSFEDLNLAIMIQKEIERVLDFKLNINKLF CCCCCCCHHHHCCCCCEEEECCCEEEEECCCCCCCCCEEEEEHHHHHHHHHHHCCCHHHE MDKKYSNSIILRECKFENEEEYKIEIKENKAIIEGSGAGLFYGCQSFRQLVREFGACIPN ECCCCCCCEEEEECCCCCCCCEEEEEECCCEEEECCCCCHHHHHHHHHHHHHHHHHHCCC LTIEDSPYFKYRGFYHDVTRGMVPTLDTLKSLVDKAAFYKINQLQLYIEHTFAFKGMSEV CEECCCCCEEECCHHHHHHCCCCCCHHHHHHHHHHHHHEEHHHEEEEEEHHHHHCCHHHH WMDKDPLTAEEILILDKYCKERHVELVPSLSTFGHLYEALRSKSFRELCELEIGDEEYSF HCCCCCCCHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHH VDRMAHHTLDVTNPKSLDFVESMLLEFIPLFSSDKFNICCDETFDLGKGKSREKAEKLGV HHHHHHHHCCCCCCCCHHHHHHHHHHHHHHCCCCCCEEEECCCCCCCCCCCHHHHHHCCC GKIYTEFLNKVYNIVKSFNKNVMFWGDIIVGYPELLSDIPEDLTCLTWNYHPQANDVATK HHHHHHHHHHHHHHHHHHCCCEEEEHHHHHCCHHHHHCCCCCCEEEEEECCCCCHHHHHH IIAEHNKVQYVCPGVGGWNMMMNLIEGSFSNIRRMVNHGIKYGAIGVLNTNWGDYGNINL HHHCCCCEEEECCCCCHHHHHHHHHHCCHHHHHHHHHCCCCCCEEEEEECCCCCCCCHHH LANSIPSMIYGAGISWNPKEEEFNEIFKSISLMEFGDESMNVVSLMDKLSKNQVAGWGEL HHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHCCCCCHHHH VRWKEKFNEREETKEEIKNIDTLKVFEGYKVASEVRREFIKLLKNTEDKEAIQSFVVSSK HHHHHHHCHHHHHHHHHHCCCCEEHHCCHHHHHHHHHHHHHHHHCCCHHHHHHHHHHCCC GWELIDKFFMVLLEREFNKKSLLDIDKKDLAKDLELWFYDYTSIWRKYNKESELNRIREV CHHHHHHHHHHHHHHHCCCHHHCCCCHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHH IVYMCSYLRG HHHHHHHHCC >Mature Secondary Structure MHLIPRPKSVINHEGEFFIERDTEIILSSELSFEDLNLAIMIQKEIERVLDFKLNINKLF CCCCCCCHHHHCCCCCEEEECCCEEEEECCCCCCCCCEEEEEHHHHHHHHHHHCCCHHHE MDKKYSNSIILRECKFENEEEYKIEIKENKAIIEGSGAGLFYGCQSFRQLVREFGACIPN ECCCCCCCEEEEECCCCCCCCEEEEEECCCEEEECCCCCHHHHHHHHHHHHHHHHHHCCC LTIEDSPYFKYRGFYHDVTRGMVPTLDTLKSLVDKAAFYKINQLQLYIEHTFAFKGMSEV CEECCCCCEEECCHHHHHHCCCCCCHHHHHHHHHHHHHEEHHHEEEEEEHHHHHCCHHHH WMDKDPLTAEEILILDKYCKERHVELVPSLSTFGHLYEALRSKSFRELCELEIGDEEYSF HCCCCCCCHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHH VDRMAHHTLDVTNPKSLDFVESMLLEFIPLFSSDKFNICCDETFDLGKGKSREKAEKLGV HHHHHHHHCCCCCCCCHHHHHHHHHHHHHHCCCCCCEEEECCCCCCCCCCCHHHHHHCCC GKIYTEFLNKVYNIVKSFNKNVMFWGDIIVGYPELLSDIPEDLTCLTWNYHPQANDVATK HHHHHHHHHHHHHHHHHHCCCEEEEHHHHHCCHHHHHCCCCCCEEEEEECCCCCHHHHHH IIAEHNKVQYVCPGVGGWNMMMNLIEGSFSNIRRMVNHGIKYGAIGVLNTNWGDYGNINL HHHCCCCEEEECCCCCHHHHHHHHHHCCHHHHHHHHHCCCCCCEEEEEECCCCCCCCHHH LANSIPSMIYGAGISWNPKEEEFNEIFKSISLMEFGDESMNVVSLMDKLSKNQVAGWGEL HHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHCCCCCHHHH VRWKEKFNEREETKEEIKNIDTLKVFEGYKVASEVRREFIKLLKNTEDKEAIQSFVVSSK HHHHHHHCHHHHHHHHHHCCCCEEHHCCHHHHHHHHHHHHHHHHCCCHHHHHHHHHHCCC GWELIDKFFMVLLEREFNKKSLLDIDKKDLAKDLELWFYDYTSIWRKYNKESELNRIREV CHHHHHHHHHHHHHHHCCCHHHCCCCHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHH IVYMCSYLRG HHHHHHHHCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 8969205 [H]