The gene/protein map for NC_009698 is currently unavailable.
Definition Clostridium botulinum A str. Hall, complete genome.
Accession NC_009698
Length 3,760,560

Click here to switch to the map view.

The map label for this gene is epsE [H]

Identifier: 153934589

GI number: 153934589

Start: 2168171

End: 2170795

Strand: Direct

Name: epsE [H]

Synonym: CLC_2045

Alternate gene names: 153934589

Gene position: 2168171-2170795 (Clockwise)

Preceding gene: 153935330

Following gene: 153935727

Centisome position: 57.66

GC content: 31.7

Gene sequence:

>2625_bases
GTGAAACCAGAAATTAGTGTTATTATGCCGGTATACAATTGTAAGCAGTATATCTTTGAATCCATTAAAAGCATATGTAA
TCAAACTTTTGAAAACTGGGAGCTTATTATTATTAATGATAATTCTATAGAAAATATTGAGGAAGAAATAAAAAAAATAC
AGGATGACAGAATTCATTATCATGCTTTTGTAGAACATGAAGGCTTATTTAATTCATTAGAATATGGTTTGCAGCAAGCA
CAGGGAGATTTTATCACATTTCATGATCCAGATGATATTAGTTCTCCTACCAGGTTTAATGAACAGCTCAATTACCTTAA
ATCCAATGATGATTTAGGGATGGTTTCATGCCTTATCAGATGTTTTACTAACGATACTAGTTATCGTAATGCCTGTACTT
TTATAGAGAAAATTCAAAATGCTTATATATCCAAAGAACAAATTGAAAATGCAATTATCAATAAATTTTCTCCAGTTATA
TTTCCTACAATAATGATGCGTAGAAGTCTATTAGATGGAATTGAATTCCATAAAGAAGAAAATGAACTAGAAGACTACTT
CCAGATATTTTTATATTTGCTTAAACAAGGTAGATTAGAAAAGGTCAACAGCGTTCTTTATTATTATAGAAGGCATAAAA
ATTCTTATCATATTCAAAATGAAAAAAATTATTCTGAAACAGTACAAGCCCAGCTAAGTAAAAGCGGAATACAAAATTTT
ATAAAATATAGGGAACTCTACAAAGATTTAAAAAAAGAGCAGTATATAGTCAGTAGATCGAAGAAAGATAGCCCCTTAAG
AATATTGATGCTTATAGATGCCCTAAATATTGGTGGAACAGAAATGTATGTATTAGAGCTTGCAAAATCCCTGGAAAAGT
TAGGGGCACATGTAGTTATCGGAACCTCTGGGGGCCCGCTAGTAGAAGTATTCAAACATTATGGATTAAAAGTTGTAAAA
ATTCCTTTTACTAGCGACTATATTTCTAATAAAAACATTATGAAGCTAATTAAATTAACAAAGAAAATAATAGATGAAGA
AAAAATCAATTTGCTTCACTGCCACCTTTTTGCAAGCATGCGTCTAGGAAATGATATTTATAGGAGCTACAAGATCCCAT
ATATAGTCACGCTACATGGCTTATTTTATCCTAATGACGTACTATTTGAGTCCTGTATCAATGCAACTAAAATTATTGCA
GTAAGCAAGCCAATTAAAAAACTAATTGAATCAAAATTAGGCTCAAGAATAAGAGGAGAAATTATGGTGCTTCCAAATGG
AATTGATATGGAAAATTTTCATCCTCAGCATACAGTAAAAGATTTTAAAACTCAGCTGGGTATACCTGAAAACTCTCAGA
TTATAACTTACTGTAGTCGTCTGGATTGGGGAAAAACCTTTGCTGCCGAAGCTTTTATTTTTGCATGTTTTACTCTAATG
GCTAAAAATAAACATCTACATGCTTTTGTTATTGGAGATGGGGCTGATAAAAATTTAATCACGCATGAAGTAAACATTCT
GAATAAAATGTTAAAAAGAGATGCAATTCATGTAGTAGGTGCGAAATTTGACGTACTCCCTTATTATCAGAATGCAGATA
TTGTAGTTGGTACTGCAAGAGTGGCACTTGAGGCCATGAGTTGTGGTAAGCCAGTTATTGCCGTAGGGAATCATGGATAT
ACCGGAATCATTAATCCTAGATGTATGAACGAGCAATGGAATATGTATTTTGGTGATCATGATTCAATAAAAAAAGCAGA
TCCCTTAGCACTTGAAAAAGATTTAAATGGATTGCTACAAGATACCGAAGCATGTAAATCCTTGGGAAAATGGGGTAGAC
GCTGGTGTGAAGAAAAATTTGATAATCGACTTGTAGCAAAGGATATTTTTAACTTATACCAAGAAGTTTTATCCGAAAAA
GAAGTAAAAAATACAGATAAAGAAAATATGCCTAATAAGATAGAAACCGATATACAGACAAAAGAAAGCCCTCTTTTAGA
AAAAACTTCTTCCATAATTATCAGAATTCCTGATGGGATTGAATTTACTCCAGAAATAAGTGAAGTAGTATTTGGTTCCA
ATAATGCACTTGCACGATACTGCACTCATTGTACCCATTGTAGATTTGACATTACGGTGCCTTTTACTATAATATTGAAA
GATAAAAAGGATTCCTGTAAAACACTAACTGTGCCTGATTTGCTTAATATTGAGTTAAATAGCTCTAACTATAATAATTG
CATTGACAAACAAGATTGTGAATCTGGAGCACTGATAAATCTTATAAATAAGTGTGGAATGAGAATAGAAAATGAAATAA
AAAATAACCCTATTATTGACGAGAATAACCAGAATATTATATTTGAGATCACTACCAAGCTATACGCTAACTTCTGTGAT
CCAGATATATTTGATCTTGAAGCTGGAATTTATGGATCATCAAGTCCTATTATTGGCGAAGATAATCTTCTAATTAAAGG
TACAGGAAAGAATGAATTTAAAAAAAATATCGCTGACGAAGATTCTACCAATATGCACCATGAACCCTTTTATTGTTATG
AAGATGATAAATCCGATTATGATGCTAACTCACTTATGAGAGGATATCCTTATAAAAGAACTTAA

Upstream 100 bases:

>100_bases
ACTTTGAATTTATTTTTAATCTCCTGCACAATGGCTACAGAGTAGAGAATCTATCTGACATCCTATACTATCAATAGATA
AAAAAAGTAGGTGAATAATT

Downstream 100 bases:

>100_bases
TAAAAAATAAATAAACTATATGAGAAAGTTGACAATGAGCAGTTATTGCACATTGTCAATTTTCAGTTTTAAGGTACATA
CCTCCTAACAAACTTTATCG

Product: glycosyl transferase, group 2 family protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 874; Mature: 874

Protein sequence:

>874_residues
MKPEISVIMPVYNCKQYIFESIKSICNQTFENWELIIINDNSIENIEEEIKKIQDDRIHYHAFVEHEGLFNSLEYGLQQA
QGDFITFHDPDDISSPTRFNEQLNYLKSNDDLGMVSCLIRCFTNDTSYRNACTFIEKIQNAYISKEQIENAIINKFSPVI
FPTIMMRRSLLDGIEFHKEENELEDYFQIFLYLLKQGRLEKVNSVLYYYRRHKNSYHIQNEKNYSETVQAQLSKSGIQNF
IKYRELYKDLKKEQYIVSRSKKDSPLRILMLIDALNIGGTEMYVLELAKSLEKLGAHVVIGTSGGPLVEVFKHYGLKVVK
IPFTSDYISNKNIMKLIKLTKKIIDEEKINLLHCHLFASMRLGNDIYRSYKIPYIVTLHGLFYPNDVLFESCINATKIIA
VSKPIKKLIESKLGSRIRGEIMVLPNGIDMENFHPQHTVKDFKTQLGIPENSQIITYCSRLDWGKTFAAEAFIFACFTLM
AKNKHLHAFVIGDGADKNLITHEVNILNKMLKRDAIHVVGAKFDVLPYYQNADIVVGTARVALEAMSCGKPVIAVGNHGY
TGIINPRCMNEQWNMYFGDHDSIKKADPLALEKDLNGLLQDTEACKSLGKWGRRWCEEKFDNRLVAKDIFNLYQEVLSEK
EVKNTDKENMPNKIETDIQTKESPLLEKTSSIIIRIPDGIEFTPEISEVVFGSNNALARYCTHCTHCRFDITVPFTIILK
DKKDSCKTLTVPDLLNIELNSSNYNNCIDKQDCESGALINLINKCGMRIENEIKNNPIIDENNQNIIFEITTKLYANFCD
PDIFDLEAGIYGSSSPIIGEDNLLIKGTGKNEFKKNIADEDSTNMHHEPFYCYEDDKSDYDANSLMRGYPYKRT

Sequences:

>Translated_874_residues
MKPEISVIMPVYNCKQYIFESIKSICNQTFENWELIIINDNSIENIEEEIKKIQDDRIHYHAFVEHEGLFNSLEYGLQQA
QGDFITFHDPDDISSPTRFNEQLNYLKSNDDLGMVSCLIRCFTNDTSYRNACTFIEKIQNAYISKEQIENAIINKFSPVI
FPTIMMRRSLLDGIEFHKEENELEDYFQIFLYLLKQGRLEKVNSVLYYYRRHKNSYHIQNEKNYSETVQAQLSKSGIQNF
IKYRELYKDLKKEQYIVSRSKKDSPLRILMLIDALNIGGTEMYVLELAKSLEKLGAHVVIGTSGGPLVEVFKHYGLKVVK
IPFTSDYISNKNIMKLIKLTKKIIDEEKINLLHCHLFASMRLGNDIYRSYKIPYIVTLHGLFYPNDVLFESCINATKIIA
VSKPIKKLIESKLGSRIRGEIMVLPNGIDMENFHPQHTVKDFKTQLGIPENSQIITYCSRLDWGKTFAAEAFIFACFTLM
AKNKHLHAFVIGDGADKNLITHEVNILNKMLKRDAIHVVGAKFDVLPYYQNADIVVGTARVALEAMSCGKPVIAVGNHGY
TGIINPRCMNEQWNMYFGDHDSIKKADPLALEKDLNGLLQDTEACKSLGKWGRRWCEEKFDNRLVAKDIFNLYQEVLSEK
EVKNTDKENMPNKIETDIQTKESPLLEKTSSIIIRIPDGIEFTPEISEVVFGSNNALARYCTHCTHCRFDITVPFTIILK
DKKDSCKTLTVPDLLNIELNSSNYNNCIDKQDCESGALINLINKCGMRIENEIKNNPIIDENNQNIIFEITTKLYANFCD
PDIFDLEAGIYGSSSPIIGEDNLLIKGTGKNEFKKNIADEDSTNMHHEPFYCYEDDKSDYDANSLMRGYPYKRT
>Mature_874_residues
MKPEISVIMPVYNCKQYIFESIKSICNQTFENWELIIINDNSIENIEEEIKKIQDDRIHYHAFVEHEGLFNSLEYGLQQA
QGDFITFHDPDDISSPTRFNEQLNYLKSNDDLGMVSCLIRCFTNDTSYRNACTFIEKIQNAYISKEQIENAIINKFSPVI
FPTIMMRRSLLDGIEFHKEENELEDYFQIFLYLLKQGRLEKVNSVLYYYRRHKNSYHIQNEKNYSETVQAQLSKSGIQNF
IKYRELYKDLKKEQYIVSRSKKDSPLRILMLIDALNIGGTEMYVLELAKSLEKLGAHVVIGTSGGPLVEVFKHYGLKVVK
IPFTSDYISNKNIMKLIKLTKKIIDEEKINLLHCHLFASMRLGNDIYRSYKIPYIVTLHGLFYPNDVLFESCINATKIIA
VSKPIKKLIESKLGSRIRGEIMVLPNGIDMENFHPQHTVKDFKTQLGIPENSQIITYCSRLDWGKTFAAEAFIFACFTLM
AKNKHLHAFVIGDGADKNLITHEVNILNKMLKRDAIHVVGAKFDVLPYYQNADIVVGTARVALEAMSCGKPVIAVGNHGY
TGIINPRCMNEQWNMYFGDHDSIKKADPLALEKDLNGLLQDTEACKSLGKWGRRWCEEKFDNRLVAKDIFNLYQEVLSEK
EVKNTDKENMPNKIETDIQTKESPLLEKTSSIIIRIPDGIEFTPEISEVVFGSNNALARYCTHCTHCRFDITVPFTIILK
DKKDSCKTLTVPDLLNIELNSSNYNNCIDKQDCESGALINLINKCGMRIENEIKNNPIIDENNQNIIFEITTKLYANFCD
PDIFDLEAGIYGSSSPIIGEDNLLIKGTGKNEFKKNIADEDSTNMHHEPFYCYEDDKSDYDANSLMRGYPYKRT

Specific function: May be involved in the production of the exopolysaccharide (EPS) component of the extracellular matrix during biofilm formation. EPS is responsible for the adhesion of chains of cells into bundles. Required for biofilm maintenance [H]

COG id: COG0463

COG function: function code M; Glycosyltransferases involved in cell wall biogenesis

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the glycosyltransferase 2 family [H]

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR001173 [H]

Pfam domain/function: PF00535 Glycos_transf_2 [H]

EC number: NA

Molecular weight: Translated: 100486; Mature: 100486

Theoretical pI: Translated: 6.25; Mature: 6.25

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

2.5 %Cys     (Translated Protein)
2.3 %Met     (Translated Protein)
4.8 %Cys+Met (Translated Protein)
2.5 %Cys     (Mature Protein)
2.3 %Met     (Mature Protein)
4.8 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKPEISVIMPVYNCKQYIFESIKSICNQTFENWELIIINDNSIENIEEEIKKIQDDRIHY
CCCCEEEEEEHHHHHHHHHHHHHHHHHHHHCCCEEEEECCCCHHHHHHHHHHHHCCCEEE
HAFVEHEGLFNSLEYGLQQAQGDFITFHDPDDISSPTRFNEQLNYLKSNDDLGMVSCLIR
EEEEECCHHHHHHHHHHHHHCCCEEEEECCCCCCCCHHHHHHHHHHCCCCCHHHHHHHHH
CFTNDTSYRNACTFIEKIQNAYISKEQIENAIINKFSPVIFPTIMMRRSLLDGIEFHKEE
HHCCCCCHHHHHHHHHHHHHHHCCHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHCCH
NELEDYFQIFLYLLKQGRLEKVNSVLYYYRRHKNSYHIQNEKNYSETVQAQLSKSGIQNF
HHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHCCCCEEECCCCCHHHHHHHHHHHHHHHHH
IKYRELYKDLKKEQYIVSRSKKDSPLRILMLIDALNIGGTEMYVLELAKSLEKLGAHVVI
HHHHHHHHHHHHHHHHHHCCCCCCCEEEEEEEEHHCCCCCHHHHHHHHHHHHHCCCEEEE
GTSGGPLVEVFKHYGLKVVKIPFTSDYISNKNIMKLIKLTKKIIDEEKINLLHCHLFASM
ECCCCHHHHHHHHCCCEEEEECCCHHHHCCHHHHHHHHHHHHHHCHHHHCEEEHHHHHHH
RLGNDIYRSYKIPYIVTLHGLFYPNDVLFESCINATKIIAVSKPIKKLIESKLGSRIRGE
HHCHHHHHHCCCCEEEEEECCCCCHHHHHHHHCCHHEEEEEHHHHHHHHHHHHCCCCCCE
IMVLPNGIDMENFHPQHTVKDFKTQLGIPENSQIITYCSRLDWGKTFAAEAFIFACFTLM
EEEECCCCCCCCCCCHHHHHHHHHHCCCCCCCCHHHHHHHCCCCHHHHHHHHHHHHHHHH
AKNKHLHAFVIGDGADKNLITHEVNILNKMLKRDAIHVVGAKFDVLPYYQNADIVVGTAR
HCCCCEEEEEEECCCCCCHHHHHHHHHHHHHHHHHHEEECCEEEEEEEECCCCEEEEHHH
VALEAMSCGKPVIAVGNHGYTGIINPRCMNEQWNMYFGDHDSIKKADPLALEKDLNGLLQ
HHHHHHHCCCCEEEECCCCCEECCCCCCCCCCCCEEECCCCCCCCCCCCHHHHHHHHHHH
DTEACKSLGKWGRRWCEEKFDNRLVAKDIFNLYQEVLSEKEVKNTDKENMPNKIETDIQT
HHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHCCCCHHCCCCHHHCCCCC
KESPLLEKTSSIIIRIPDGIEFTPEISEVVFGSNNALARYCTHCTHCRFDITVPFTIILK
CCCCHHHCCCCEEEECCCCCCCCCCHHHHEECCCCHHHHHHHHHHCCEEEEEEEEEEEEE
DKKDSCKTLTVPDLLNIELNSSNYNNCIDKQDCESGALINLINKCGMRIENEIKNNPIID
CCCCCCCEEECCCEEEEEECCCCCCCCCCCCCCCCCHHHHHHHHCCCCCHHHHCCCCCCC
ENNQNIIFEITTKLYANFCDPDIFDLEAGIYGSSSPIIGEDNLLIKGTGKNEFKKNIADE
CCCCEEEEEEEHHHHHHCCCCCCEEECCCCCCCCCCCCCCCCEEEEECCCHHHHHHCCCC
DSTNMHHEPFYCYEDDKSDYDANSLMRGYPYKRT
CCCCCCCCCEEEECCCCCCCCHHHHHHCCCCCCC
>Mature Secondary Structure
MKPEISVIMPVYNCKQYIFESIKSICNQTFENWELIIINDNSIENIEEEIKKIQDDRIHY
CCCCEEEEEEHHHHHHHHHHHHHHHHHHHHCCCEEEEECCCCHHHHHHHHHHHHCCCEEE
HAFVEHEGLFNSLEYGLQQAQGDFITFHDPDDISSPTRFNEQLNYLKSNDDLGMVSCLIR
EEEEECCHHHHHHHHHHHHHCCCEEEEECCCCCCCCHHHHHHHHHHCCCCCHHHHHHHHH
CFTNDTSYRNACTFIEKIQNAYISKEQIENAIINKFSPVIFPTIMMRRSLLDGIEFHKEE
HHCCCCCHHHHHHHHHHHHHHHCCHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHCCH
NELEDYFQIFLYLLKQGRLEKVNSVLYYYRRHKNSYHIQNEKNYSETVQAQLSKSGIQNF
HHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHCCCCEEECCCCCHHHHHHHHHHHHHHHHH
IKYRELYKDLKKEQYIVSRSKKDSPLRILMLIDALNIGGTEMYVLELAKSLEKLGAHVVI
HHHHHHHHHHHHHHHHHHCCCCCCCEEEEEEEEHHCCCCCHHHHHHHHHHHHHCCCEEEE
GTSGGPLVEVFKHYGLKVVKIPFTSDYISNKNIMKLIKLTKKIIDEEKINLLHCHLFASM
ECCCCHHHHHHHHCCCEEEEECCCHHHHCCHHHHHHHHHHHHHHCHHHHCEEEHHHHHHH
RLGNDIYRSYKIPYIVTLHGLFYPNDVLFESCINATKIIAVSKPIKKLIESKLGSRIRGE
HHCHHHHHHCCCCEEEEEECCCCCHHHHHHHHCCHHEEEEEHHHHHHHHHHHHCCCCCCE
IMVLPNGIDMENFHPQHTVKDFKTQLGIPENSQIITYCSRLDWGKTFAAEAFIFACFTLM
EEEECCCCCCCCCCCHHHHHHHHHHCCCCCCCCHHHHHHHCCCCHHHHHHHHHHHHHHHH
AKNKHLHAFVIGDGADKNLITHEVNILNKMLKRDAIHVVGAKFDVLPYYQNADIVVGTAR
HCCCCEEEEEEECCCCCCHHHHHHHHHHHHHHHHHHEEECCEEEEEEEECCCCEEEEHHH
VALEAMSCGKPVIAVGNHGYTGIINPRCMNEQWNMYFGDHDSIKKADPLALEKDLNGLLQ
HHHHHHHCCCCEEEECCCCCEECCCCCCCCCCCCEEECCCCCCCCCCCCHHHHHHHHHHH
DTEACKSLGKWGRRWCEEKFDNRLVAKDIFNLYQEVLSEKEVKNTDKENMPNKIETDIQT
HHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHCCCCHHCCCCHHHCCCCC
KESPLLEKTSSIIIRIPDGIEFTPEISEVVFGSNNALARYCTHCTHCRFDITVPFTIILK
CCCCHHHCCCCEEEECCCCCCCCCCHHHHEECCCCHHHHHHHHHHCCEEEEEEEEEEEEE
DKKDSCKTLTVPDLLNIELNSSNYNNCIDKQDCESGALINLINKCGMRIENEIKNNPIID
CCCCCCCEEECCCEEEEEECCCCCCCCCCCCCCCCCHHHHHHHHCCCCCHHHHCCCCCCC
ENNQNIIFEITTKLYANFCDPDIFDLEAGIYGSSSPIIGEDNLLIKGTGKNEFKKNIADE
CCCCEEEEEEEHHHHHHCCCCCCEEECCCCCCCCCCCCCCCCEEEEECCCHHHHHHCCCC
DSTNMHHEPFYCYEDDKSDYDANSLMRGYPYKRT
CCCCCCCCCEEEECCCCCCCCHHHHHHCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 8969506; 9384377 [H]