Definition Clostridium botulinum A str. Hall, complete genome.
Accession NC_009698
Length 3,760,560

Click here to switch to the map view.

The map label for this gene is epsE [H]

Identifier: 153935330

GI number: 153935330

Start: 2166798

End: 2168147

Strand: Direct

Name: epsE [H]

Synonym: CLC_2044

Alternate gene names: 153935330

Gene position: 2166798-2168147 (Clockwise)

Preceding gene: 153937421

Following gene: 153934589

Centisome position: 57.62

GC content: 32.07

Gene sequence:

>1350_bases
ATGACAATGTTATATGATCGGGCAGCAGGACTTGTAAGCGTAATTATCTCTGCCTATAATTATGATCGCTATATAATTGA
TACTCTTGAAAGTTTAAAAAGACAAACCTATTCTAATATAGAGATTATTTTGATGGATGATTGTTCACAGGATAACACAA
AAACTATTGTAAATGAATGGCTTACTGAAAATGCGGATAAGTTTACGGACTTTATATATGTACGGCTACCAAGAAATCTT
GGTTTCGAGTGGGCCGTAAATATTGGCTTATGTCTATCAAAAGGAGAGTATGTTGTATTCCACGACGCTGATGACATTAG
TCATGATGAAAAAATTGAAAAGCAGGTAAAATATCTTCAAAAGCATCCTAATACTGCCGCATTAGGTACTGTATTTTCAT
CTTTTCGCGATGATATATCAAACGTTATATCTACCAGCAACTGGATTAGTTTTGATGCAAATGAAATTGAAAGAAACTAT
AAGTTTGATATTAAGCACTGTGTATGCTATGGGACACTTATGATCCGTGCCTATATTATCGACGAAATCATTGGCTTCAA
TAAAGCAGTTCTATTTTCTAATGATTTCTTTTTTGTAAATAATATTGTACATCATGGCTTTATCGTTGAGAACTTAAATG
AAAACCTGTATTTCTACAGAAACCATGATAAGCAATTTTCACGCAATCTTTATGAGGACGATACCGTAACTCATAACTAC
AAAGAAAAAAGGGAAAAAAATGAAGGCCAAGCAAGTATCGTTGTACCAATAAAAGGTATATCAGATAAAGTCAAGGAAAC
CTTGGAGAGTATAGCCTCTCAAACTTACGATAATCTTGAATTAGTTATTATAGATGAGCAGCCTGATATTGATACAGAAG
ACATTATTAGAAAATGGGCAGAACCATATAAAAATAATGGTAAATTTAAAGATTTAGTATATTTCCCTCTACCAAGGGAA
GTTGGATTTCCTTGGATTTATAATATAGGGGCTTATCTTTCTAAAGGAGAATTTATAGCATTTCACAATATTGGAGGTAA
AAGCCATCCAAAACGAATAGAAAAACAGATTGAGTTTTTAAGAAACAATTTCATGTATAGTGTTGTAGGTACAAATTATA
ATGACAGTGGAAATTATATAAAATTCAAGGATGATATTGAATATTCCTATACCGTTGATTTTATGCCTTGCATGAATTTT
AATACGCTTCTTTTTCGCAGTGACATTATAGATAAAACTGGAGGTATAAATAAACGTATTGATGGTGCAGAAGACTTTGA
ATTTATTTTTAATCTCCTGCACAATGGCTACAGAGTAGAGAATCTATCTGACATCCTATACTATCAATAG

Upstream 100 bases:

>100_bases
GTTAATAAAATGTTTTCTTTGAGTAGTTTCAATGAATCATTTATGTATCCTATATAAACTCGCTTTAAAAAATGGTTTAC
TTCTAGAGGAGTGATATAAA

Downstream 100 bases:

>100_bases
ATAAAAAAAGTAGGTGAATAATTGTGAAACCAGAAATTAGTGTTATTATGCCGGTATACAATTGTAAGCAGTATATCTTT
GAATCCATTAAAAGCATATG

Product: glycosyl transferase, group 2 family protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 449; Mature: 448

Protein sequence:

>449_residues
MTMLYDRAAGLVSVIISAYNYDRYIIDTLESLKRQTYSNIEIILMDDCSQDNTKTIVNEWLTENADKFTDFIYVRLPRNL
GFEWAVNIGLCLSKGEYVVFHDADDISHDEKIEKQVKYLQKHPNTAALGTVFSSFRDDISNVISTSNWISFDANEIERNY
KFDIKHCVCYGTLMIRAYIIDEIIGFNKAVLFSNDFFFVNNIVHHGFIVENLNENLYFYRNHDKQFSRNLYEDDTVTHNY
KEKREKNEGQASIVVPIKGISDKVKETLESIASQTYDNLELVIIDEQPDIDTEDIIRKWAEPYKNNGKFKDLVYFPLPRE
VGFPWIYNIGAYLSKGEFIAFHNIGGKSHPKRIEKQIEFLRNNFMYSVVGTNYNDSGNYIKFKDDIEYSYTVDFMPCMNF
NTLLFRSDIIDKTGGINKRIDGAEDFEFIFNLLHNGYRVENLSDILYYQ

Sequences:

>Translated_449_residues
MTMLYDRAAGLVSVIISAYNYDRYIIDTLESLKRQTYSNIEIILMDDCSQDNTKTIVNEWLTENADKFTDFIYVRLPRNL
GFEWAVNIGLCLSKGEYVVFHDADDISHDEKIEKQVKYLQKHPNTAALGTVFSSFRDDISNVISTSNWISFDANEIERNY
KFDIKHCVCYGTLMIRAYIIDEIIGFNKAVLFSNDFFFVNNIVHHGFIVENLNENLYFYRNHDKQFSRNLYEDDTVTHNY
KEKREKNEGQASIVVPIKGISDKVKETLESIASQTYDNLELVIIDEQPDIDTEDIIRKWAEPYKNNGKFKDLVYFPLPRE
VGFPWIYNIGAYLSKGEFIAFHNIGGKSHPKRIEKQIEFLRNNFMYSVVGTNYNDSGNYIKFKDDIEYSYTVDFMPCMNF
NTLLFRSDIIDKTGGINKRIDGAEDFEFIFNLLHNGYRVENLSDILYYQ
>Mature_448_residues
TMLYDRAAGLVSVIISAYNYDRYIIDTLESLKRQTYSNIEIILMDDCSQDNTKTIVNEWLTENADKFTDFIYVRLPRNLG
FEWAVNIGLCLSKGEYVVFHDADDISHDEKIEKQVKYLQKHPNTAALGTVFSSFRDDISNVISTSNWISFDANEIERNYK
FDIKHCVCYGTLMIRAYIIDEIIGFNKAVLFSNDFFFVNNIVHHGFIVENLNENLYFYRNHDKQFSRNLYEDDTVTHNYK
EKREKNEGQASIVVPIKGISDKVKETLESIASQTYDNLELVIIDEQPDIDTEDIIRKWAEPYKNNGKFKDLVYFPLPREV
GFPWIYNIGAYLSKGEFIAFHNIGGKSHPKRIEKQIEFLRNNFMYSVVGTNYNDSGNYIKFKDDIEYSYTVDFMPCMNFN
TLLFRSDIIDKTGGINKRIDGAEDFEFIFNLLHNGYRVENLSDILYYQ

Specific function: May be involved in the production of the exopolysaccharide (EPS) component of the extracellular matrix during biofilm formation. EPS is responsible for the adhesion of chains of cells into bundles. Required for biofilm maintenance [H]

COG id: COG0463

COG function: function code M; Glycosyltransferases involved in cell wall biogenesis

Gene ontology:

Cell location: Integral Membrane Protein [C]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the glycosyltransferase 2 family [H]

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR001173 [H]

Pfam domain/function: PF00535 Glycos_transf_2 [H]

EC number: NA

Molecular weight: Translated: 52537; Mature: 52406

Theoretical pI: Translated: 4.81; Mature: 4.81

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.1 %Cys     (Translated Protein)
1.6 %Met     (Translated Protein)
2.7 %Cys+Met (Translated Protein)
1.1 %Cys     (Mature Protein)
1.3 %Met     (Mature Protein)
2.5 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MTMLYDRAAGLVSVIISAYNYDRYIIDTLESLKRQTYSNIEIILMDDCSQDNTKTIVNEW
CCEEHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHCCCEEEEEEECCCCCCHHHHHHHH
LTENADKFTDFIYVRLPRNLGFEWAVNIGLCLSKGEYVVFHDADDISHDEKIEKQVKYLQ
HHCCCHHHEEEEEEEECCCCCCEEEEEEEEEECCCCEEEEECCCCCCCHHHHHHHHHHHH
KHPNTAALGTVFSSFRDDISNVISTSNWISFDANEIERNYKFDIKHCVCYGTLMIRAYII
HCCCHHHHHHHHHHHHHHHHHHHCCCCCEEECHHHHCCCCCCCHHHHHHHHHHHHHHHHH
DEIIGFNKAVLFSNDFFFVNNIVHHGFIVENLNENLYFYRNHDKQFSRNLYEDDTVTHNY
HHHHCCCCEEEEECCCCEEHHHHHCCEEEEECCCCEEEEECCCHHHHHCCCCCCCCCCCH
KEKREKNEGQASIVVPIKGISDKVKETLESIASQTYDNLELVIIDEQPDIDTEDIIRKWA
HHHHHCCCCCEEEEEEECCCHHHHHHHHHHHHHCCCCCEEEEEECCCCCCCHHHHHHHHH
EPYKNNGKFKDLVYFPLPREVGFPWIYNIGAYLSKGEFIAFHNIGGKSHPKRIEKQIEFL
HHHCCCCCEEEEEEECCCHHCCCCEEEHHHHHHCCCCEEEEECCCCCCCHHHHHHHHHHH
RNNFMYSVVGTNYNDSGNYIKFKDDIEYSYTVDFMPCMNFNTLLFRSDIIDKTGGINKRI
HCCCEEEEEECCCCCCCCEEEEECCCCEEEEEEEEECCCCCCEEEEHHHHHCCCCCCCCC
DGAEDFEFIFNLLHNGYRVENLSDILYYQ
CCCHHHHHHHHHHHCCEEECCHHHHHCCC
>Mature Secondary Structure 
TMLYDRAAGLVSVIISAYNYDRYIIDTLESLKRQTYSNIEIILMDDCSQDNTKTIVNEW
CEEHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHCCCEEEEEEECCCCCCHHHHHHHH
LTENADKFTDFIYVRLPRNLGFEWAVNIGLCLSKGEYVVFHDADDISHDEKIEKQVKYLQ
HHCCCHHHEEEEEEEECCCCCCEEEEEEEEEECCCCEEEEECCCCCCCHHHHHHHHHHHH
KHPNTAALGTVFSSFRDDISNVISTSNWISFDANEIERNYKFDIKHCVCYGTLMIRAYII
HCCCHHHHHHHHHHHHHHHHHHHCCCCCEEECHHHHCCCCCCCHHHHHHHHHHHHHHHHH
DEIIGFNKAVLFSNDFFFVNNIVHHGFIVENLNENLYFYRNHDKQFSRNLYEDDTVTHNY
HHHHCCCCEEEEECCCCEEHHHHHCCEEEEECCCCEEEEECCCHHHHHCCCCCCCCCCCH
KEKREKNEGQASIVVPIKGISDKVKETLESIASQTYDNLELVIIDEQPDIDTEDIIRKWA
HHHHHCCCCCEEEEEEECCCHHHHHHHHHHHHHCCCCCEEEEEECCCCCCCHHHHHHHHH
EPYKNNGKFKDLVYFPLPREVGFPWIYNIGAYLSKGEFIAFHNIGGKSHPKRIEKQIEFL
HHHCCCCCEEEEEEECCCHHCCCCEEEHHHHHHCCCCEEEEECCCCCCCHHHHHHHHHHH
RNNFMYSVVGTNYNDSGNYIKFKDDIEYSYTVDFMPCMNFNTLLFRSDIIDKTGGINKRI
HCCCEEEEEECCCCCCCCEEEEECCCCEEEEEEEEECCCCCCEEEEHHHHHCCCCCCCCC
DGAEDFEFIFNLLHNGYRVENLSDILYYQ
CCCHHHHHHHHHHHCCEEECCHHHHHCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 8969506; 9384377 [H]