| Definition | Clostridium botulinum A str. Hall, complete genome. |
|---|---|
| Accession | NC_009698 |
| Length | 3,760,560 |
Click here to switch to the map view.
The map label for this gene is epsE [H]
Identifier: 153935330
GI number: 153935330
Start: 2166798
End: 2168147
Strand: Direct
Name: epsE [H]
Synonym: CLC_2044
Alternate gene names: 153935330
Gene position: 2166798-2168147 (Clockwise)
Preceding gene: 153937421
Following gene: 153934589
Centisome position: 57.62
GC content: 32.07
Gene sequence:
>1350_bases ATGACAATGTTATATGATCGGGCAGCAGGACTTGTAAGCGTAATTATCTCTGCCTATAATTATGATCGCTATATAATTGA TACTCTTGAAAGTTTAAAAAGACAAACCTATTCTAATATAGAGATTATTTTGATGGATGATTGTTCACAGGATAACACAA AAACTATTGTAAATGAATGGCTTACTGAAAATGCGGATAAGTTTACGGACTTTATATATGTACGGCTACCAAGAAATCTT GGTTTCGAGTGGGCCGTAAATATTGGCTTATGTCTATCAAAAGGAGAGTATGTTGTATTCCACGACGCTGATGACATTAG TCATGATGAAAAAATTGAAAAGCAGGTAAAATATCTTCAAAAGCATCCTAATACTGCCGCATTAGGTACTGTATTTTCAT CTTTTCGCGATGATATATCAAACGTTATATCTACCAGCAACTGGATTAGTTTTGATGCAAATGAAATTGAAAGAAACTAT AAGTTTGATATTAAGCACTGTGTATGCTATGGGACACTTATGATCCGTGCCTATATTATCGACGAAATCATTGGCTTCAA TAAAGCAGTTCTATTTTCTAATGATTTCTTTTTTGTAAATAATATTGTACATCATGGCTTTATCGTTGAGAACTTAAATG AAAACCTGTATTTCTACAGAAACCATGATAAGCAATTTTCACGCAATCTTTATGAGGACGATACCGTAACTCATAACTAC AAAGAAAAAAGGGAAAAAAATGAAGGCCAAGCAAGTATCGTTGTACCAATAAAAGGTATATCAGATAAAGTCAAGGAAAC CTTGGAGAGTATAGCCTCTCAAACTTACGATAATCTTGAATTAGTTATTATAGATGAGCAGCCTGATATTGATACAGAAG ACATTATTAGAAAATGGGCAGAACCATATAAAAATAATGGTAAATTTAAAGATTTAGTATATTTCCCTCTACCAAGGGAA GTTGGATTTCCTTGGATTTATAATATAGGGGCTTATCTTTCTAAAGGAGAATTTATAGCATTTCACAATATTGGAGGTAA AAGCCATCCAAAACGAATAGAAAAACAGATTGAGTTTTTAAGAAACAATTTCATGTATAGTGTTGTAGGTACAAATTATA ATGACAGTGGAAATTATATAAAATTCAAGGATGATATTGAATATTCCTATACCGTTGATTTTATGCCTTGCATGAATTTT AATACGCTTCTTTTTCGCAGTGACATTATAGATAAAACTGGAGGTATAAATAAACGTATTGATGGTGCAGAAGACTTTGA ATTTATTTTTAATCTCCTGCACAATGGCTACAGAGTAGAGAATCTATCTGACATCCTATACTATCAATAG
Upstream 100 bases:
>100_bases GTTAATAAAATGTTTTCTTTGAGTAGTTTCAATGAATCATTTATGTATCCTATATAAACTCGCTTTAAAAAATGGTTTAC TTCTAGAGGAGTGATATAAA
Downstream 100 bases:
>100_bases ATAAAAAAAGTAGGTGAATAATTGTGAAACCAGAAATTAGTGTTATTATGCCGGTATACAATTGTAAGCAGTATATCTTT GAATCCATTAAAAGCATATG
Product: glycosyl transferase, group 2 family protein
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 449; Mature: 448
Protein sequence:
>449_residues MTMLYDRAAGLVSVIISAYNYDRYIIDTLESLKRQTYSNIEIILMDDCSQDNTKTIVNEWLTENADKFTDFIYVRLPRNL GFEWAVNIGLCLSKGEYVVFHDADDISHDEKIEKQVKYLQKHPNTAALGTVFSSFRDDISNVISTSNWISFDANEIERNY KFDIKHCVCYGTLMIRAYIIDEIIGFNKAVLFSNDFFFVNNIVHHGFIVENLNENLYFYRNHDKQFSRNLYEDDTVTHNY KEKREKNEGQASIVVPIKGISDKVKETLESIASQTYDNLELVIIDEQPDIDTEDIIRKWAEPYKNNGKFKDLVYFPLPRE VGFPWIYNIGAYLSKGEFIAFHNIGGKSHPKRIEKQIEFLRNNFMYSVVGTNYNDSGNYIKFKDDIEYSYTVDFMPCMNF NTLLFRSDIIDKTGGINKRIDGAEDFEFIFNLLHNGYRVENLSDILYYQ
Sequences:
>Translated_449_residues MTMLYDRAAGLVSVIISAYNYDRYIIDTLESLKRQTYSNIEIILMDDCSQDNTKTIVNEWLTENADKFTDFIYVRLPRNL GFEWAVNIGLCLSKGEYVVFHDADDISHDEKIEKQVKYLQKHPNTAALGTVFSSFRDDISNVISTSNWISFDANEIERNY KFDIKHCVCYGTLMIRAYIIDEIIGFNKAVLFSNDFFFVNNIVHHGFIVENLNENLYFYRNHDKQFSRNLYEDDTVTHNY KEKREKNEGQASIVVPIKGISDKVKETLESIASQTYDNLELVIIDEQPDIDTEDIIRKWAEPYKNNGKFKDLVYFPLPRE VGFPWIYNIGAYLSKGEFIAFHNIGGKSHPKRIEKQIEFLRNNFMYSVVGTNYNDSGNYIKFKDDIEYSYTVDFMPCMNF NTLLFRSDIIDKTGGINKRIDGAEDFEFIFNLLHNGYRVENLSDILYYQ >Mature_448_residues TMLYDRAAGLVSVIISAYNYDRYIIDTLESLKRQTYSNIEIILMDDCSQDNTKTIVNEWLTENADKFTDFIYVRLPRNLG FEWAVNIGLCLSKGEYVVFHDADDISHDEKIEKQVKYLQKHPNTAALGTVFSSFRDDISNVISTSNWISFDANEIERNYK FDIKHCVCYGTLMIRAYIIDEIIGFNKAVLFSNDFFFVNNIVHHGFIVENLNENLYFYRNHDKQFSRNLYEDDTVTHNYK EKREKNEGQASIVVPIKGISDKVKETLESIASQTYDNLELVIIDEQPDIDTEDIIRKWAEPYKNNGKFKDLVYFPLPREV GFPWIYNIGAYLSKGEFIAFHNIGGKSHPKRIEKQIEFLRNNFMYSVVGTNYNDSGNYIKFKDDIEYSYTVDFMPCMNFN TLLFRSDIIDKTGGINKRIDGAEDFEFIFNLLHNGYRVENLSDILYYQ
Specific function: May be involved in the production of the exopolysaccharide (EPS) component of the extracellular matrix during biofilm formation. EPS is responsible for the adhesion of chains of cells into bundles. Required for biofilm maintenance [H]
COG id: COG0463
COG function: function code M; Glycosyltransferases involved in cell wall biogenesis
Gene ontology:
Cell location: Integral Membrane Protein [C]
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the glycosyltransferase 2 family [H]
Homologues:
None
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR001173 [H]
Pfam domain/function: PF00535 Glycos_transf_2 [H]
EC number: NA
Molecular weight: Translated: 52537; Mature: 52406
Theoretical pI: Translated: 4.81; Mature: 4.81
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.1 %Cys (Translated Protein) 1.6 %Met (Translated Protein) 2.7 %Cys+Met (Translated Protein) 1.1 %Cys (Mature Protein) 1.3 %Met (Mature Protein) 2.5 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MTMLYDRAAGLVSVIISAYNYDRYIIDTLESLKRQTYSNIEIILMDDCSQDNTKTIVNEW CCEEHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHCCCEEEEEEECCCCCCHHHHHHHH LTENADKFTDFIYVRLPRNLGFEWAVNIGLCLSKGEYVVFHDADDISHDEKIEKQVKYLQ HHCCCHHHEEEEEEEECCCCCCEEEEEEEEEECCCCEEEEECCCCCCCHHHHHHHHHHHH KHPNTAALGTVFSSFRDDISNVISTSNWISFDANEIERNYKFDIKHCVCYGTLMIRAYII HCCCHHHHHHHHHHHHHHHHHHHCCCCCEEECHHHHCCCCCCCHHHHHHHHHHHHHHHHH DEIIGFNKAVLFSNDFFFVNNIVHHGFIVENLNENLYFYRNHDKQFSRNLYEDDTVTHNY HHHHCCCCEEEEECCCCEEHHHHHCCEEEEECCCCEEEEECCCHHHHHCCCCCCCCCCCH KEKREKNEGQASIVVPIKGISDKVKETLESIASQTYDNLELVIIDEQPDIDTEDIIRKWA HHHHHCCCCCEEEEEEECCCHHHHHHHHHHHHHCCCCCEEEEEECCCCCCCHHHHHHHHH EPYKNNGKFKDLVYFPLPREVGFPWIYNIGAYLSKGEFIAFHNIGGKSHPKRIEKQIEFL HHHCCCCCEEEEEEECCCHHCCCCEEEHHHHHHCCCCEEEEECCCCCCCHHHHHHHHHHH RNNFMYSVVGTNYNDSGNYIKFKDDIEYSYTVDFMPCMNFNTLLFRSDIIDKTGGINKRI HCCCEEEEEECCCCCCCCEEEEECCCCEEEEEEEEECCCCCCEEEEHHHHHCCCCCCCCC DGAEDFEFIFNLLHNGYRVENLSDILYYQ CCCHHHHHHHHHHHCCEEECCHHHHHCCC >Mature Secondary Structure TMLYDRAAGLVSVIISAYNYDRYIIDTLESLKRQTYSNIEIILMDDCSQDNTKTIVNEW CEEHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHCCCEEEEEEECCCCCCHHHHHHHH LTENADKFTDFIYVRLPRNLGFEWAVNIGLCLSKGEYVVFHDADDISHDEKIEKQVKYLQ HHCCCHHHEEEEEEEECCCCCCEEEEEEEEEECCCCEEEEECCCCCCCHHHHHHHHHHHH KHPNTAALGTVFSSFRDDISNVISTSNWISFDANEIERNYKFDIKHCVCYGTLMIRAYII HCCCHHHHHHHHHHHHHHHHHHHCCCCCEEECHHHHCCCCCCCHHHHHHHHHHHHHHHHH DEIIGFNKAVLFSNDFFFVNNIVHHGFIVENLNENLYFYRNHDKQFSRNLYEDDTVTHNY HHHHCCCCEEEEECCCCEEHHHHHCCEEEEECCCCEEEEECCCHHHHHCCCCCCCCCCCH KEKREKNEGQASIVVPIKGISDKVKETLESIASQTYDNLELVIIDEQPDIDTEDIIRKWA HHHHHCCCCCEEEEEEECCCHHHHHHHHHHHHHCCCCCEEEEEECCCCCCCHHHHHHHHH EPYKNNGKFKDLVYFPLPREVGFPWIYNIGAYLSKGEFIAFHNIGGKSHPKRIEKQIEFL HHHCCCCCEEEEEEECCCHHCCCCEEEHHHHHHCCCCEEEEECCCCCCCHHHHHHHHHHH RNNFMYSVVGTNYNDSGNYIKFKDDIEYSYTVDFMPCMNFNTLLFRSDIIDKTGGINKRI HCCCEEEEEECCCCCCCCEEEEECCCCEEEEEEEEECCCCCCEEEEHHHHHCCCCCCCCC DGAEDFEFIFNLLHNGYRVENLSDILYYQ CCCHHHHHHHHHHHCCEEECCHHHHHCCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 6.0
TargetDB status: NA
Availability: NA
References: 8969506; 9384377 [H]