Definition Lactobacillus plantarum WCFS1, complete genome.
Accession NC_004567
Length 3,308,274

Click here to switch to the map view.

The map label for this gene is epsH [H]

Identifier: 28378440

GI number: 28378440

Start: 1598760

End: 1599992

Strand: Direct

Name: epsH [H]

Synonym: lp_1763

Alternate gene names: 28378440

Gene position: 1598760-1599992 (Clockwise)

Preceding gene: 28378439

Following gene: 28378441

Centisome position: 48.33

GC content: 45.34

Gene sequence:

>1233_bases
ATTGTTGATGATGGTAGTACGGACGGCACGGCTACAATTTGTGACCAATATTGTGCGCGCTGGCCGCACCTATTTCGGGT
TATCCATCAACGTAACCAAGGACAGGGACCTGCACGTAATGCGGGGATTACCGCCGCGCATGGCCGCTATTTAGGTTTTG
TCGATGCTGATGATTGGGTCGAACCGACGATGTATGCGACCTTAGTAGCAACGGCTGAGCGTAGTCATGCCCAAATCGTC
GTTTGTGATGTTCGTAAAATCTACGCGGCGACTCACCGCACAACTAGTCTGCTGAGCTTGCCAGATGCGACTGATCATGT
GGCAATTGCGACTTATCTTAAATACGGTCTAAATAATGCTTATTCCGGAAATAAATTATATGCACGTTCGTGTTGGCAGA
AATATCGTTACCAGCGGATGGTCTACGAGGATTTAGATATTTTGCTGGACATGTTGAGTTGCTGTGAGCGAGTCGCCTAT
GTGCAACAACCATTTTATAATTATTATAAACATGCTGGTTCGACAACTTTAGATTATACCAACCCACGACTGTTTGATAT
TATGACAGCCTATCAAGATGCCATTGAGCACGCCAAGGTGACGTATCAGGATGCGGTGACTTATTGCGTCGCTAAGCGAA
TTTTGATTAATTTAGCAACGCCAGGCTTTGCCGATTATCTAGCGGAGTTTATTGAACTGATACGACAATTGCGTCCTATT
TTTGAAGCCAGTCCGTCAATAATGAGTGATCCGGCTATTAAAAAAATTTGTGATTATGCAGGTCAATTGACATTACCCCG
GCGATTTATCTGTGAGCGTGAGGACTGGGCTCAATCGTGGCATCAGTATAGTCGGAATTTCAAAACGATTATACCGGTAG
CTAAAGCATTGCCGGCCGATTTACGACAACGGTCTAACCACTTTAAACTCGATTATTGGTTGTTGAAAACGTTATTTGAA
CAAGGTGGCTTGCTGATTTTGGGTACCGTCAAGTTGCACCGCCCGTTTGGCCGTTTACGGGCGGGAGGTGACGTGTTAGC
CTTTGAAGGTGAACATTGTTTATTAGTTGGTGCGCAACCACGTTCCCCACTGATTTCTGAATTACTGCAACAGTTGATTG
TTGGTTCCGAGTCACTAACAGAGTTGCTGACAATGGTTAAGGCACAGCCAGAACGATGGTCAGCGGGTACGCATAAGATT
CGCTTGGTTGACATAAAAGATTGGCTACAATAG

Upstream 100 bases:

>100_bases
TCAAGTTTCTGTTATTGTGGCTGCGTATAATGAGGAGCACTGGTTAAGGCGTTGTTTGACCTCATAAAAAAAACAGACAT
TAGCGGCCTTAGAAGTCATT

Downstream 100 bases:

>100_bases
GGCGACGGGTCACTGAGTCATGCAGAGCAGCGGACTCAGTGACCTATTTAGTCATTGGTTACATTGAAAATGAATAAAAA
CTAAATAGCAATTTAAAATA

Product: glycosyltransferase

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 410; Mature: 410

Protein sequence:

>410_residues
MVDDGSTDGTATICDQYCARWPHLFRVIHQRNQGQGPARNAGITAAHGRYLGFVDADDWVEPTMYATLVATAERSHAQIV
VCDVRKIYAATHRTTSLLSLPDATDHVAIATYLKYGLNNAYSGNKLYARSCWQKYRYQRMVYEDLDILLDMLSCCERVAY
VQQPFYNYYKHAGSTTLDYTNPRLFDIMTAYQDAIEHAKVTYQDAVTYCVAKRILINLATPGFADYLAEFIELIRQLRPI
FEASPSIMSDPAIKKICDYAGQLTLPRRFICEREDWAQSWHQYSRNFKTIIPVAKALPADLRQRSNHFKLDYWLLKTLFE
QGGLLILGTVKLHRPFGRLRAGGDVLAFEGEHCLLVGAQPRSPLISELLQQLIVGSESLTELLTMVKAQPERWSAGTHKI
RLVDIKDWLQ

Sequences:

>Translated_410_residues
MVDDGSTDGTATICDQYCARWPHLFRVIHQRNQGQGPARNAGITAAHGRYLGFVDADDWVEPTMYATLVATAERSHAQIV
VCDVRKIYAATHRTTSLLSLPDATDHVAIATYLKYGLNNAYSGNKLYARSCWQKYRYQRMVYEDLDILLDMLSCCERVAY
VQQPFYNYYKHAGSTTLDYTNPRLFDIMTAYQDAIEHAKVTYQDAVTYCVAKRILINLATPGFADYLAEFIELIRQLRPI
FEASPSIMSDPAIKKICDYAGQLTLPRRFICEREDWAQSWHQYSRNFKTIIPVAKALPADLRQRSNHFKLDYWLLKTLFE
QGGLLILGTVKLHRPFGRLRAGGDVLAFEGEHCLLVGAQPRSPLISELLQQLIVGSESLTELLTMVKAQPERWSAGTHKI
RLVDIKDWLQ
>Mature_410_residues
MVDDGSTDGTATICDQYCARWPHLFRVIHQRNQGQGPARNAGITAAHGRYLGFVDADDWVEPTMYATLVATAERSHAQIV
VCDVRKIYAATHRTTSLLSLPDATDHVAIATYLKYGLNNAYSGNKLYARSCWQKYRYQRMVYEDLDILLDMLSCCERVAY
VQQPFYNYYKHAGSTTLDYTNPRLFDIMTAYQDAIEHAKVTYQDAVTYCVAKRILINLATPGFADYLAEFIELIRQLRPI
FEASPSIMSDPAIKKICDYAGQLTLPRRFICEREDWAQSWHQYSRNFKTIIPVAKALPADLRQRSNHFKLDYWLLKTLFE
QGGLLILGTVKLHRPFGRLRAGGDVLAFEGEHCLLVGAQPRSPLISELLQQLIVGSESLTELLTMVKAQPERWSAGTHKI
RLVDIKDWLQ

Specific function: May be involved in the production of the exopolysaccharide (EPS) component of the extracellular matrix during biofilm formation. EPS is responsible for the adhesion of chains of cells into bundles. Required for biofilm maintenance [H]

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the glycosyltransferase 2 family [H]

Homologues:

Organism=Escherichia coli, GI1790044, Length=199, Percent_Identity=30.1507537688442, Blast_Score=84, Evalue=2e-17,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR001173 [H]

Pfam domain/function: PF00535 Glycos_transf_2 [H]

EC number: 2.-.-.- [C]

Molecular weight: Translated: 46741; Mature: 46741

Theoretical pI: Translated: 7.93; Mature: 7.93

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

2.4 %Cys     (Translated Protein)
1.7 %Met     (Translated Protein)
4.1 %Cys+Met (Translated Protein)
2.4 %Cys     (Mature Protein)
1.7 %Met     (Mature Protein)
4.1 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MVDDGSTDGTATICDQYCARWPHLFRVIHQRNQGQGPARNAGITAAHGRYLGFVDADDWV
CCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCEEECCCEEEEECCCCCC
EPTMYATLVATAERSHAQIVVCDVRKIYAATHRTTSLLSLPDATDHVAIATYLKYGLNNA
CHHHHHHHHHHHCCCCCEEEEECHHHHHHHHHHHHHEEECCCCCCHHHHHHHHHHCCCCC
YSGNKLYARSCWQKYRYQRMVYEDLDILLDMLSCCERVAYVQQPFYNYYKHAGSTTLDYT
CCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEECCC
NPRLFDIMTAYQDAIEHAKVTYQDAVTYCVAKRILINLATPGFADYLAEFIELIRQLRPI
CCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHH
FEASPSIMSDPAIKKICDYAGQLTLPRRFICEREDWAQSWHQYSRNFKTIIPVAKALPAD
HHCCCCCCCCHHHHHHHHHCCCCCCCHHHHCCCHHHHHHHHHHHCCCHHHHHHHHHCCHH
LRQRSNHFKLDYWLLKTLFEQGGLLILGTVKLHRPFGRLRAGGDVLAFEGEHCLLVGAQP
HHHCCCCCCHHHHHHHHHHHCCCEEEEEEEEHHCCHHHHCCCCCEEEECCCEEEEEECCC
RSPLISELLQQLIVGSESLTELLTMVKAQPERWSAGTHKIRLVDIKDWLQ
CCHHHHHHHHHHHCCCHHHHHHHHHHHCCCCCCCCCCCEEEEEEHHHHCC
>Mature Secondary Structure
MVDDGSTDGTATICDQYCARWPHLFRVIHQRNQGQGPARNAGITAAHGRYLGFVDADDWV
CCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCEEECCCEEEEECCCCCC
EPTMYATLVATAERSHAQIVVCDVRKIYAATHRTTSLLSLPDATDHVAIATYLKYGLNNA
CHHHHHHHHHHHCCCCCEEEEECHHHHHHHHHHHHHEEECCCCCCHHHHHHHHHHCCCCC
YSGNKLYARSCWQKYRYQRMVYEDLDILLDMLSCCERVAYVQQPFYNYYKHAGSTTLDYT
CCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEECCC
NPRLFDIMTAYQDAIEHAKVTYQDAVTYCVAKRILINLATPGFADYLAEFIELIRQLRPI
CCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHH
FEASPSIMSDPAIKKICDYAGQLTLPRRFICEREDWAQSWHQYSRNFKTIIPVAKALPAD
HHCCCCCCCCHHHHHHHHHCCCCCCCHHHHCCCHHHHHHHHHHHCCCHHHHHHHHHCCHH
LRQRSNHFKLDYWLLKTLFEQGGLLILGTVKLHRPFGRLRAGGDVLAFEGEHCLLVGAQP
HHHCCCCCCHHHHHHHHHHHCCCEEEEEEEEHHCCHHHHCCCCCEEEECCCEEEEEECCC
RSPLISELLQQLIVGSESLTELLTMVKAQPERWSAGTHKIRLVDIKDWLQ
CCHHHHHHHHHHHCCCHHHHHHHHHHHCCCCCCCCCCCEEEEEEHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 8969506; 9384377 [H]