| Definition | Lactobacillus plantarum WCFS1, complete genome. |
|---|---|
| Accession | NC_004567 |
| Length | 3,308,274 |
Click here to switch to the map view.
The map label for this gene is epsH [H]
Identifier: 28378440
GI number: 28378440
Start: 1598760
End: 1599992
Strand: Direct
Name: epsH [H]
Synonym: lp_1763
Alternate gene names: 28378440
Gene position: 1598760-1599992 (Clockwise)
Preceding gene: 28378439
Following gene: 28378441
Centisome position: 48.33
GC content: 45.34
Gene sequence:
>1233_bases ATTGTTGATGATGGTAGTACGGACGGCACGGCTACAATTTGTGACCAATATTGTGCGCGCTGGCCGCACCTATTTCGGGT TATCCATCAACGTAACCAAGGACAGGGACCTGCACGTAATGCGGGGATTACCGCCGCGCATGGCCGCTATTTAGGTTTTG TCGATGCTGATGATTGGGTCGAACCGACGATGTATGCGACCTTAGTAGCAACGGCTGAGCGTAGTCATGCCCAAATCGTC GTTTGTGATGTTCGTAAAATCTACGCGGCGACTCACCGCACAACTAGTCTGCTGAGCTTGCCAGATGCGACTGATCATGT GGCAATTGCGACTTATCTTAAATACGGTCTAAATAATGCTTATTCCGGAAATAAATTATATGCACGTTCGTGTTGGCAGA AATATCGTTACCAGCGGATGGTCTACGAGGATTTAGATATTTTGCTGGACATGTTGAGTTGCTGTGAGCGAGTCGCCTAT GTGCAACAACCATTTTATAATTATTATAAACATGCTGGTTCGACAACTTTAGATTATACCAACCCACGACTGTTTGATAT TATGACAGCCTATCAAGATGCCATTGAGCACGCCAAGGTGACGTATCAGGATGCGGTGACTTATTGCGTCGCTAAGCGAA TTTTGATTAATTTAGCAACGCCAGGCTTTGCCGATTATCTAGCGGAGTTTATTGAACTGATACGACAATTGCGTCCTATT TTTGAAGCCAGTCCGTCAATAATGAGTGATCCGGCTATTAAAAAAATTTGTGATTATGCAGGTCAATTGACATTACCCCG GCGATTTATCTGTGAGCGTGAGGACTGGGCTCAATCGTGGCATCAGTATAGTCGGAATTTCAAAACGATTATACCGGTAG CTAAAGCATTGCCGGCCGATTTACGACAACGGTCTAACCACTTTAAACTCGATTATTGGTTGTTGAAAACGTTATTTGAA CAAGGTGGCTTGCTGATTTTGGGTACCGTCAAGTTGCACCGCCCGTTTGGCCGTTTACGGGCGGGAGGTGACGTGTTAGC CTTTGAAGGTGAACATTGTTTATTAGTTGGTGCGCAACCACGTTCCCCACTGATTTCTGAATTACTGCAACAGTTGATTG TTGGTTCCGAGTCACTAACAGAGTTGCTGACAATGGTTAAGGCACAGCCAGAACGATGGTCAGCGGGTACGCATAAGATT CGCTTGGTTGACATAAAAGATTGGCTACAATAG
Upstream 100 bases:
>100_bases TCAAGTTTCTGTTATTGTGGCTGCGTATAATGAGGAGCACTGGTTAAGGCGTTGTTTGACCTCATAAAAAAAACAGACAT TAGCGGCCTTAGAAGTCATT
Downstream 100 bases:
>100_bases GGCGACGGGTCACTGAGTCATGCAGAGCAGCGGACTCAGTGACCTATTTAGTCATTGGTTACATTGAAAATGAATAAAAA CTAAATAGCAATTTAAAATA
Product: glycosyltransferase
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 410; Mature: 410
Protein sequence:
>410_residues MVDDGSTDGTATICDQYCARWPHLFRVIHQRNQGQGPARNAGITAAHGRYLGFVDADDWVEPTMYATLVATAERSHAQIV VCDVRKIYAATHRTTSLLSLPDATDHVAIATYLKYGLNNAYSGNKLYARSCWQKYRYQRMVYEDLDILLDMLSCCERVAY VQQPFYNYYKHAGSTTLDYTNPRLFDIMTAYQDAIEHAKVTYQDAVTYCVAKRILINLATPGFADYLAEFIELIRQLRPI FEASPSIMSDPAIKKICDYAGQLTLPRRFICEREDWAQSWHQYSRNFKTIIPVAKALPADLRQRSNHFKLDYWLLKTLFE QGGLLILGTVKLHRPFGRLRAGGDVLAFEGEHCLLVGAQPRSPLISELLQQLIVGSESLTELLTMVKAQPERWSAGTHKI RLVDIKDWLQ
Sequences:
>Translated_410_residues MVDDGSTDGTATICDQYCARWPHLFRVIHQRNQGQGPARNAGITAAHGRYLGFVDADDWVEPTMYATLVATAERSHAQIV VCDVRKIYAATHRTTSLLSLPDATDHVAIATYLKYGLNNAYSGNKLYARSCWQKYRYQRMVYEDLDILLDMLSCCERVAY VQQPFYNYYKHAGSTTLDYTNPRLFDIMTAYQDAIEHAKVTYQDAVTYCVAKRILINLATPGFADYLAEFIELIRQLRPI FEASPSIMSDPAIKKICDYAGQLTLPRRFICEREDWAQSWHQYSRNFKTIIPVAKALPADLRQRSNHFKLDYWLLKTLFE QGGLLILGTVKLHRPFGRLRAGGDVLAFEGEHCLLVGAQPRSPLISELLQQLIVGSESLTELLTMVKAQPERWSAGTHKI RLVDIKDWLQ >Mature_410_residues MVDDGSTDGTATICDQYCARWPHLFRVIHQRNQGQGPARNAGITAAHGRYLGFVDADDWVEPTMYATLVATAERSHAQIV VCDVRKIYAATHRTTSLLSLPDATDHVAIATYLKYGLNNAYSGNKLYARSCWQKYRYQRMVYEDLDILLDMLSCCERVAY VQQPFYNYYKHAGSTTLDYTNPRLFDIMTAYQDAIEHAKVTYQDAVTYCVAKRILINLATPGFADYLAEFIELIRQLRPI FEASPSIMSDPAIKKICDYAGQLTLPRRFICEREDWAQSWHQYSRNFKTIIPVAKALPADLRQRSNHFKLDYWLLKTLFE QGGLLILGTVKLHRPFGRLRAGGDVLAFEGEHCLLVGAQPRSPLISELLQQLIVGSESLTELLTMVKAQPERWSAGTHKI RLVDIKDWLQ
Specific function: May be involved in the production of the exopolysaccharide (EPS) component of the extracellular matrix during biofilm formation. EPS is responsible for the adhesion of chains of cells into bundles. Required for biofilm maintenance [H]
COG id: NA
COG function: NA
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the glycosyltransferase 2 family [H]
Homologues:
Organism=Escherichia coli, GI1790044, Length=199, Percent_Identity=30.1507537688442, Blast_Score=84, Evalue=2e-17,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR001173 [H]
Pfam domain/function: PF00535 Glycos_transf_2 [H]
EC number: 2.-.-.- [C]
Molecular weight: Translated: 46741; Mature: 46741
Theoretical pI: Translated: 7.93; Mature: 7.93
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
2.4 %Cys (Translated Protein) 1.7 %Met (Translated Protein) 4.1 %Cys+Met (Translated Protein) 2.4 %Cys (Mature Protein) 1.7 %Met (Mature Protein) 4.1 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MVDDGSTDGTATICDQYCARWPHLFRVIHQRNQGQGPARNAGITAAHGRYLGFVDADDWV CCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCEEECCCEEEEECCCCCC EPTMYATLVATAERSHAQIVVCDVRKIYAATHRTTSLLSLPDATDHVAIATYLKYGLNNA CHHHHHHHHHHHCCCCCEEEEECHHHHHHHHHHHHHEEECCCCCCHHHHHHHHHHCCCCC YSGNKLYARSCWQKYRYQRMVYEDLDILLDMLSCCERVAYVQQPFYNYYKHAGSTTLDYT CCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEECCC NPRLFDIMTAYQDAIEHAKVTYQDAVTYCVAKRILINLATPGFADYLAEFIELIRQLRPI CCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHH FEASPSIMSDPAIKKICDYAGQLTLPRRFICEREDWAQSWHQYSRNFKTIIPVAKALPAD HHCCCCCCCCHHHHHHHHHCCCCCCCHHHHCCCHHHHHHHHHHHCCCHHHHHHHHHCCHH LRQRSNHFKLDYWLLKTLFEQGGLLILGTVKLHRPFGRLRAGGDVLAFEGEHCLLVGAQP HHHCCCCCCHHHHHHHHHHHCCCEEEEEEEEHHCCHHHHCCCCCEEEECCCEEEEEECCC RSPLISELLQQLIVGSESLTELLTMVKAQPERWSAGTHKIRLVDIKDWLQ CCHHHHHHHHHHHCCCHHHHHHHHHHHCCCCCCCCCCCEEEEEEHHHHCC >Mature Secondary Structure MVDDGSTDGTATICDQYCARWPHLFRVIHQRNQGQGPARNAGITAAHGRYLGFVDADDWV CCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCEEECCCEEEEECCCCCC EPTMYATLVATAERSHAQIVVCDVRKIYAATHRTTSLLSLPDATDHVAIATYLKYGLNNA CHHHHHHHHHHHCCCCCEEEEECHHHHHHHHHHHHHEEECCCCCCHHHHHHHHHHCCCCC YSGNKLYARSCWQKYRYQRMVYEDLDILLDMLSCCERVAYVQQPFYNYYKHAGSTTLDYT CCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEECCC NPRLFDIMTAYQDAIEHAKVTYQDAVTYCVAKRILINLATPGFADYLAEFIELIRQLRPI CCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHH FEASPSIMSDPAIKKICDYAGQLTLPRRFICEREDWAQSWHQYSRNFKTIIPVAKALPAD HHCCCCCCCCHHHHHHHHHCCCCCCCHHHHCCCHHHHHHHHHHHCCCHHHHHHHHHCCHH LRQRSNHFKLDYWLLKTLFEQGGLLILGTVKLHRPFGRLRAGGDVLAFEGEHCLLVGAQP HHHCCCCCCHHHHHHHHHHHCCCEEEEEEEEHHCCHHHHCCCCCEEEECCCEEEEEECCC RSPLISELLQQLIVGSESLTELLTMVKAQPERWSAGTHKIRLVDIKDWLQ CCHHHHHHHHHHHCCCHHHHHHHHHHHCCCCCCCCCCCEEEEEEHHHHCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 8969506; 9384377 [H]