| Definition | Clostridium botulinum A str. Hall, complete genome. |
|---|---|
| Accession | NC_009698 |
| Length | 3,760,560 |
Click here to switch to the map view.
The map label for this gene is epsE [H]
Identifier: 153934589
GI number: 153934589
Start: 2168171
End: 2170795
Strand: Direct
Name: epsE [H]
Synonym: CLC_2045
Alternate gene names: 153934589
Gene position: 2168171-2170795 (Clockwise)
Preceding gene: 153935330
Following gene: 153935727
Centisome position: 57.66
GC content: 31.7
Gene sequence:
>2625_bases GTGAAACCAGAAATTAGTGTTATTATGCCGGTATACAATTGTAAGCAGTATATCTTTGAATCCATTAAAAGCATATGTAA TCAAACTTTTGAAAACTGGGAGCTTATTATTATTAATGATAATTCTATAGAAAATATTGAGGAAGAAATAAAAAAAATAC AGGATGACAGAATTCATTATCATGCTTTTGTAGAACATGAAGGCTTATTTAATTCATTAGAATATGGTTTGCAGCAAGCA CAGGGAGATTTTATCACATTTCATGATCCAGATGATATTAGTTCTCCTACCAGGTTTAATGAACAGCTCAATTACCTTAA ATCCAATGATGATTTAGGGATGGTTTCATGCCTTATCAGATGTTTTACTAACGATACTAGTTATCGTAATGCCTGTACTT TTATAGAGAAAATTCAAAATGCTTATATATCCAAAGAACAAATTGAAAATGCAATTATCAATAAATTTTCTCCAGTTATA TTTCCTACAATAATGATGCGTAGAAGTCTATTAGATGGAATTGAATTCCATAAAGAAGAAAATGAACTAGAAGACTACTT CCAGATATTTTTATATTTGCTTAAACAAGGTAGATTAGAAAAGGTCAACAGCGTTCTTTATTATTATAGAAGGCATAAAA ATTCTTATCATATTCAAAATGAAAAAAATTATTCTGAAACAGTACAAGCCCAGCTAAGTAAAAGCGGAATACAAAATTTT ATAAAATATAGGGAACTCTACAAAGATTTAAAAAAAGAGCAGTATATAGTCAGTAGATCGAAGAAAGATAGCCCCTTAAG AATATTGATGCTTATAGATGCCCTAAATATTGGTGGAACAGAAATGTATGTATTAGAGCTTGCAAAATCCCTGGAAAAGT TAGGGGCACATGTAGTTATCGGAACCTCTGGGGGCCCGCTAGTAGAAGTATTCAAACATTATGGATTAAAAGTTGTAAAA ATTCCTTTTACTAGCGACTATATTTCTAATAAAAACATTATGAAGCTAATTAAATTAACAAAGAAAATAATAGATGAAGA AAAAATCAATTTGCTTCACTGCCACCTTTTTGCAAGCATGCGTCTAGGAAATGATATTTATAGGAGCTACAAGATCCCAT ATATAGTCACGCTACATGGCTTATTTTATCCTAATGACGTACTATTTGAGTCCTGTATCAATGCAACTAAAATTATTGCA GTAAGCAAGCCAATTAAAAAACTAATTGAATCAAAATTAGGCTCAAGAATAAGAGGAGAAATTATGGTGCTTCCAAATGG AATTGATATGGAAAATTTTCATCCTCAGCATACAGTAAAAGATTTTAAAACTCAGCTGGGTATACCTGAAAACTCTCAGA TTATAACTTACTGTAGTCGTCTGGATTGGGGAAAAACCTTTGCTGCCGAAGCTTTTATTTTTGCATGTTTTACTCTAATG GCTAAAAATAAACATCTACATGCTTTTGTTATTGGAGATGGGGCTGATAAAAATTTAATCACGCATGAAGTAAACATTCT GAATAAAATGTTAAAAAGAGATGCAATTCATGTAGTAGGTGCGAAATTTGACGTACTCCCTTATTATCAGAATGCAGATA TTGTAGTTGGTACTGCAAGAGTGGCACTTGAGGCCATGAGTTGTGGTAAGCCAGTTATTGCCGTAGGGAATCATGGATAT ACCGGAATCATTAATCCTAGATGTATGAACGAGCAATGGAATATGTATTTTGGTGATCATGATTCAATAAAAAAAGCAGA TCCCTTAGCACTTGAAAAAGATTTAAATGGATTGCTACAAGATACCGAAGCATGTAAATCCTTGGGAAAATGGGGTAGAC GCTGGTGTGAAGAAAAATTTGATAATCGACTTGTAGCAAAGGATATTTTTAACTTATACCAAGAAGTTTTATCCGAAAAA GAAGTAAAAAATACAGATAAAGAAAATATGCCTAATAAGATAGAAACCGATATACAGACAAAAGAAAGCCCTCTTTTAGA AAAAACTTCTTCCATAATTATCAGAATTCCTGATGGGATTGAATTTACTCCAGAAATAAGTGAAGTAGTATTTGGTTCCA ATAATGCACTTGCACGATACTGCACTCATTGTACCCATTGTAGATTTGACATTACGGTGCCTTTTACTATAATATTGAAA GATAAAAAGGATTCCTGTAAAACACTAACTGTGCCTGATTTGCTTAATATTGAGTTAAATAGCTCTAACTATAATAATTG CATTGACAAACAAGATTGTGAATCTGGAGCACTGATAAATCTTATAAATAAGTGTGGAATGAGAATAGAAAATGAAATAA AAAATAACCCTATTATTGACGAGAATAACCAGAATATTATATTTGAGATCACTACCAAGCTATACGCTAACTTCTGTGAT CCAGATATATTTGATCTTGAAGCTGGAATTTATGGATCATCAAGTCCTATTATTGGCGAAGATAATCTTCTAATTAAAGG TACAGGAAAGAATGAATTTAAAAAAAATATCGCTGACGAAGATTCTACCAATATGCACCATGAACCCTTTTATTGTTATG AAGATGATAAATCCGATTATGATGCTAACTCACTTATGAGAGGATATCCTTATAAAAGAACTTAA
Upstream 100 bases:
>100_bases ACTTTGAATTTATTTTTAATCTCCTGCACAATGGCTACAGAGTAGAGAATCTATCTGACATCCTATACTATCAATAGATA AAAAAAGTAGGTGAATAATT
Downstream 100 bases:
>100_bases TAAAAAATAAATAAACTATATGAGAAAGTTGACAATGAGCAGTTATTGCACATTGTCAATTTTCAGTTTTAAGGTACATA CCTCCTAACAAACTTTATCG
Product: glycosyl transferase, group 2 family protein
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 874; Mature: 874
Protein sequence:
>874_residues MKPEISVIMPVYNCKQYIFESIKSICNQTFENWELIIINDNSIENIEEEIKKIQDDRIHYHAFVEHEGLFNSLEYGLQQA QGDFITFHDPDDISSPTRFNEQLNYLKSNDDLGMVSCLIRCFTNDTSYRNACTFIEKIQNAYISKEQIENAIINKFSPVI FPTIMMRRSLLDGIEFHKEENELEDYFQIFLYLLKQGRLEKVNSVLYYYRRHKNSYHIQNEKNYSETVQAQLSKSGIQNF IKYRELYKDLKKEQYIVSRSKKDSPLRILMLIDALNIGGTEMYVLELAKSLEKLGAHVVIGTSGGPLVEVFKHYGLKVVK IPFTSDYISNKNIMKLIKLTKKIIDEEKINLLHCHLFASMRLGNDIYRSYKIPYIVTLHGLFYPNDVLFESCINATKIIA VSKPIKKLIESKLGSRIRGEIMVLPNGIDMENFHPQHTVKDFKTQLGIPENSQIITYCSRLDWGKTFAAEAFIFACFTLM AKNKHLHAFVIGDGADKNLITHEVNILNKMLKRDAIHVVGAKFDVLPYYQNADIVVGTARVALEAMSCGKPVIAVGNHGY TGIINPRCMNEQWNMYFGDHDSIKKADPLALEKDLNGLLQDTEACKSLGKWGRRWCEEKFDNRLVAKDIFNLYQEVLSEK EVKNTDKENMPNKIETDIQTKESPLLEKTSSIIIRIPDGIEFTPEISEVVFGSNNALARYCTHCTHCRFDITVPFTIILK DKKDSCKTLTVPDLLNIELNSSNYNNCIDKQDCESGALINLINKCGMRIENEIKNNPIIDENNQNIIFEITTKLYANFCD PDIFDLEAGIYGSSSPIIGEDNLLIKGTGKNEFKKNIADEDSTNMHHEPFYCYEDDKSDYDANSLMRGYPYKRT
Sequences:
>Translated_874_residues MKPEISVIMPVYNCKQYIFESIKSICNQTFENWELIIINDNSIENIEEEIKKIQDDRIHYHAFVEHEGLFNSLEYGLQQA QGDFITFHDPDDISSPTRFNEQLNYLKSNDDLGMVSCLIRCFTNDTSYRNACTFIEKIQNAYISKEQIENAIINKFSPVI FPTIMMRRSLLDGIEFHKEENELEDYFQIFLYLLKQGRLEKVNSVLYYYRRHKNSYHIQNEKNYSETVQAQLSKSGIQNF IKYRELYKDLKKEQYIVSRSKKDSPLRILMLIDALNIGGTEMYVLELAKSLEKLGAHVVIGTSGGPLVEVFKHYGLKVVK IPFTSDYISNKNIMKLIKLTKKIIDEEKINLLHCHLFASMRLGNDIYRSYKIPYIVTLHGLFYPNDVLFESCINATKIIA VSKPIKKLIESKLGSRIRGEIMVLPNGIDMENFHPQHTVKDFKTQLGIPENSQIITYCSRLDWGKTFAAEAFIFACFTLM AKNKHLHAFVIGDGADKNLITHEVNILNKMLKRDAIHVVGAKFDVLPYYQNADIVVGTARVALEAMSCGKPVIAVGNHGY TGIINPRCMNEQWNMYFGDHDSIKKADPLALEKDLNGLLQDTEACKSLGKWGRRWCEEKFDNRLVAKDIFNLYQEVLSEK EVKNTDKENMPNKIETDIQTKESPLLEKTSSIIIRIPDGIEFTPEISEVVFGSNNALARYCTHCTHCRFDITVPFTIILK DKKDSCKTLTVPDLLNIELNSSNYNNCIDKQDCESGALINLINKCGMRIENEIKNNPIIDENNQNIIFEITTKLYANFCD PDIFDLEAGIYGSSSPIIGEDNLLIKGTGKNEFKKNIADEDSTNMHHEPFYCYEDDKSDYDANSLMRGYPYKRT >Mature_874_residues MKPEISVIMPVYNCKQYIFESIKSICNQTFENWELIIINDNSIENIEEEIKKIQDDRIHYHAFVEHEGLFNSLEYGLQQA QGDFITFHDPDDISSPTRFNEQLNYLKSNDDLGMVSCLIRCFTNDTSYRNACTFIEKIQNAYISKEQIENAIINKFSPVI FPTIMMRRSLLDGIEFHKEENELEDYFQIFLYLLKQGRLEKVNSVLYYYRRHKNSYHIQNEKNYSETVQAQLSKSGIQNF IKYRELYKDLKKEQYIVSRSKKDSPLRILMLIDALNIGGTEMYVLELAKSLEKLGAHVVIGTSGGPLVEVFKHYGLKVVK IPFTSDYISNKNIMKLIKLTKKIIDEEKINLLHCHLFASMRLGNDIYRSYKIPYIVTLHGLFYPNDVLFESCINATKIIA VSKPIKKLIESKLGSRIRGEIMVLPNGIDMENFHPQHTVKDFKTQLGIPENSQIITYCSRLDWGKTFAAEAFIFACFTLM AKNKHLHAFVIGDGADKNLITHEVNILNKMLKRDAIHVVGAKFDVLPYYQNADIVVGTARVALEAMSCGKPVIAVGNHGY TGIINPRCMNEQWNMYFGDHDSIKKADPLALEKDLNGLLQDTEACKSLGKWGRRWCEEKFDNRLVAKDIFNLYQEVLSEK EVKNTDKENMPNKIETDIQTKESPLLEKTSSIIIRIPDGIEFTPEISEVVFGSNNALARYCTHCTHCRFDITVPFTIILK DKKDSCKTLTVPDLLNIELNSSNYNNCIDKQDCESGALINLINKCGMRIENEIKNNPIIDENNQNIIFEITTKLYANFCD PDIFDLEAGIYGSSSPIIGEDNLLIKGTGKNEFKKNIADEDSTNMHHEPFYCYEDDKSDYDANSLMRGYPYKRT
Specific function: May be involved in the production of the exopolysaccharide (EPS) component of the extracellular matrix during biofilm formation. EPS is responsible for the adhesion of chains of cells into bundles. Required for biofilm maintenance [H]
COG id: COG0463
COG function: function code M; Glycosyltransferases involved in cell wall biogenesis
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the glycosyltransferase 2 family [H]
Homologues:
None
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR001173 [H]
Pfam domain/function: PF00535 Glycos_transf_2 [H]
EC number: NA
Molecular weight: Translated: 100486; Mature: 100486
Theoretical pI: Translated: 6.25; Mature: 6.25
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
2.5 %Cys (Translated Protein) 2.3 %Met (Translated Protein) 4.8 %Cys+Met (Translated Protein) 2.5 %Cys (Mature Protein) 2.3 %Met (Mature Protein) 4.8 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MKPEISVIMPVYNCKQYIFESIKSICNQTFENWELIIINDNSIENIEEEIKKIQDDRIHY CCCCEEEEEEHHHHHHHHHHHHHHHHHHHHCCCEEEEECCCCHHHHHHHHHHHHCCCEEE HAFVEHEGLFNSLEYGLQQAQGDFITFHDPDDISSPTRFNEQLNYLKSNDDLGMVSCLIR EEEEECCHHHHHHHHHHHHHCCCEEEEECCCCCCCCHHHHHHHHHHCCCCCHHHHHHHHH CFTNDTSYRNACTFIEKIQNAYISKEQIENAIINKFSPVIFPTIMMRRSLLDGIEFHKEE HHCCCCCHHHHHHHHHHHHHHHCCHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHCCH NELEDYFQIFLYLLKQGRLEKVNSVLYYYRRHKNSYHIQNEKNYSETVQAQLSKSGIQNF HHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHCCCCEEECCCCCHHHHHHHHHHHHHHHHH IKYRELYKDLKKEQYIVSRSKKDSPLRILMLIDALNIGGTEMYVLELAKSLEKLGAHVVI HHHHHHHHHHHHHHHHHHCCCCCCCEEEEEEEEHHCCCCCHHHHHHHHHHHHHCCCEEEE GTSGGPLVEVFKHYGLKVVKIPFTSDYISNKNIMKLIKLTKKIIDEEKINLLHCHLFASM ECCCCHHHHHHHHCCCEEEEECCCHHHHCCHHHHHHHHHHHHHHCHHHHCEEEHHHHHHH RLGNDIYRSYKIPYIVTLHGLFYPNDVLFESCINATKIIAVSKPIKKLIESKLGSRIRGE HHCHHHHHHCCCCEEEEEECCCCCHHHHHHHHCCHHEEEEEHHHHHHHHHHHHCCCCCCE IMVLPNGIDMENFHPQHTVKDFKTQLGIPENSQIITYCSRLDWGKTFAAEAFIFACFTLM EEEECCCCCCCCCCCHHHHHHHHHHCCCCCCCCHHHHHHHCCCCHHHHHHHHHHHHHHHH AKNKHLHAFVIGDGADKNLITHEVNILNKMLKRDAIHVVGAKFDVLPYYQNADIVVGTAR HCCCCEEEEEEECCCCCCHHHHHHHHHHHHHHHHHHEEECCEEEEEEEECCCCEEEEHHH VALEAMSCGKPVIAVGNHGYTGIINPRCMNEQWNMYFGDHDSIKKADPLALEKDLNGLLQ HHHHHHHCCCCEEEECCCCCEECCCCCCCCCCCCEEECCCCCCCCCCCCHHHHHHHHHHH DTEACKSLGKWGRRWCEEKFDNRLVAKDIFNLYQEVLSEKEVKNTDKENMPNKIETDIQT HHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHCCCCHHCCCCHHHCCCCC KESPLLEKTSSIIIRIPDGIEFTPEISEVVFGSNNALARYCTHCTHCRFDITVPFTIILK CCCCHHHCCCCEEEECCCCCCCCCCHHHHEECCCCHHHHHHHHHHCCEEEEEEEEEEEEE DKKDSCKTLTVPDLLNIELNSSNYNNCIDKQDCESGALINLINKCGMRIENEIKNNPIID CCCCCCCEEECCCEEEEEECCCCCCCCCCCCCCCCCHHHHHHHHCCCCCHHHHCCCCCCC ENNQNIIFEITTKLYANFCDPDIFDLEAGIYGSSSPIIGEDNLLIKGTGKNEFKKNIADE CCCCEEEEEEEHHHHHHCCCCCCEEECCCCCCCCCCCCCCCCEEEEECCCHHHHHHCCCC DSTNMHHEPFYCYEDDKSDYDANSLMRGYPYKRT CCCCCCCCCEEEECCCCCCCCHHHHHHCCCCCCC >Mature Secondary Structure MKPEISVIMPVYNCKQYIFESIKSICNQTFENWELIIINDNSIENIEEEIKKIQDDRIHY CCCCEEEEEEHHHHHHHHHHHHHHHHHHHHCCCEEEEECCCCHHHHHHHHHHHHCCCEEE HAFVEHEGLFNSLEYGLQQAQGDFITFHDPDDISSPTRFNEQLNYLKSNDDLGMVSCLIR EEEEECCHHHHHHHHHHHHHCCCEEEEECCCCCCCCHHHHHHHHHHCCCCCHHHHHHHHH CFTNDTSYRNACTFIEKIQNAYISKEQIENAIINKFSPVIFPTIMMRRSLLDGIEFHKEE HHCCCCCHHHHHHHHHHHHHHHCCHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHCCH NELEDYFQIFLYLLKQGRLEKVNSVLYYYRRHKNSYHIQNEKNYSETVQAQLSKSGIQNF HHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHCCCCEEECCCCCHHHHHHHHHHHHHHHHH IKYRELYKDLKKEQYIVSRSKKDSPLRILMLIDALNIGGTEMYVLELAKSLEKLGAHVVI HHHHHHHHHHHHHHHHHHCCCCCCCEEEEEEEEHHCCCCCHHHHHHHHHHHHHCCCEEEE GTSGGPLVEVFKHYGLKVVKIPFTSDYISNKNIMKLIKLTKKIIDEEKINLLHCHLFASM ECCCCHHHHHHHHCCCEEEEECCCHHHHCCHHHHHHHHHHHHHHCHHHHCEEEHHHHHHH RLGNDIYRSYKIPYIVTLHGLFYPNDVLFESCINATKIIAVSKPIKKLIESKLGSRIRGE HHCHHHHHHCCCCEEEEEECCCCCHHHHHHHHCCHHEEEEEHHHHHHHHHHHHCCCCCCE IMVLPNGIDMENFHPQHTVKDFKTQLGIPENSQIITYCSRLDWGKTFAAEAFIFACFTLM EEEECCCCCCCCCCCHHHHHHHHHHCCCCCCCCHHHHHHHCCCCHHHHHHHHHHHHHHHH AKNKHLHAFVIGDGADKNLITHEVNILNKMLKRDAIHVVGAKFDVLPYYQNADIVVGTAR HCCCCEEEEEEECCCCCCHHHHHHHHHHHHHHHHHHEEECCEEEEEEEECCCCEEEEHHH VALEAMSCGKPVIAVGNHGYTGIINPRCMNEQWNMYFGDHDSIKKADPLALEKDLNGLLQ HHHHHHHCCCCEEEECCCCCEECCCCCCCCCCCCEEECCCCCCCCCCCCHHHHHHHHHHH DTEACKSLGKWGRRWCEEKFDNRLVAKDIFNLYQEVLSEKEVKNTDKENMPNKIETDIQT HHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHCCCCHHCCCCHHHCCCCC KESPLLEKTSSIIIRIPDGIEFTPEISEVVFGSNNALARYCTHCTHCRFDITVPFTIILK CCCCHHHCCCCEEEECCCCCCCCCCHHHHEECCCCHHHHHHHHHHCCEEEEEEEEEEEEE DKKDSCKTLTVPDLLNIELNSSNYNNCIDKQDCESGALINLINKCGMRIENEIKNNPIID CCCCCCCEEECCCEEEEEECCCCCCCCCCCCCCCCCHHHHHHHHCCCCCHHHHCCCCCCC ENNQNIIFEITTKLYANFCDPDIFDLEAGIYGSSSPIIGEDNLLIKGTGKNEFKKNIADE CCCCEEEEEEEHHHHHHCCCCCCEEECCCCCCCCCCCCCCCCEEEEECCCHHHHHHCCCC DSTNMHHEPFYCYEDDKSDYDANSLMRGYPYKRT CCCCCCCCCEEEECCCCCCCCHHHHHHCCCCCCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 8969506; 9384377 [H]