Definition Streptococcus pneumoniae ATCC 700669, complete genome.
Accession NC_011900
Length 2,221,315

Click here to switch to the map view.

The map label for this gene is epsH [H]

Identifier: 221232509

GI number: 221232509

Start: 1719298

End: 1721382

Strand: Reverse

Name: epsH [H]

Synonym: SPN23F_17810

Alternate gene names: 221232509

Gene position: 1721382-1719298 (Counterclockwise)

Preceding gene: 221232510

Following gene: 221232508

Centisome position: 77.49

GC content: 35.3

Gene sequence:

>2085_bases
GTGGATGATAAAATAACGGTCATTGTACCAGTATACAATGTGGAAAACTATCTGAGGAAGTGCCTAGATAGTATTATTAC
TCAAACATATAAAAATATTGAGATTGTTGTCGTTAATGATGGTTCTACGGATGCTTCAGGTGAAATTTGTAAAGAATTTT
CAGAAATGGATCACCGAATTCTCTATATAGAACAAGAAAATGCTGGTCTTTCTGCCGCACGAAACACCGGTCTGAATAAT
ATGTCCGGAAATTATGTGACCTTTGTGGACTCGGATGATTGGATTGAGTTAGATTATGTAGAAACCCTATATAAAGAAAT
AACAGAATATCAAGCTGATATTGCAGTTGGGAATTACTATTCTTTCAACGAAAGTGAAGGAATGTTCTACTTTCATATAT
CAGGAGACTCCTATTATGAGAAGGTATATGACAATGTTTCCATCTTTGAGAATTTGTATGAAACTCAAGAAATGAGGAGT
TTCGCTTTGATATCTGCTTGGGGTAAACTCTATAAGGCGAGATTGTTTGAGCAGTTGCGCTTTGACATGGGTAAATTAGG
AGAAGATGGTTACCTCAATCAAAAGGTATATTTATTATCAGAAAAGGTAATTTATTTAAATAAAAGTCTTTATGCTTATC
GTATTAGAAAAGGTAGTCTATCAAGAATTTGGACAGAAAAGTGGATGCATGCATTGGTTGATGCCATGTCCGAACGCATT
ACGCTACTAGCTAATATGGGTTACCCTTTAGAAAAGCATTTGGCGATTTATCGTCAAATGTTGGAATTCAGTCTCTCCAA
CGGTCAAGCTAGCGGTTTATCTGACACAGCAACATATAAAGAGTTTGAAATGAAACAAAGGCTTTTAAATCAGCTATCGA
GACAAGAGGAAAGTGAAAAGAAAGCCATTGTCCTAGCAGCAAATTATGCCTATGTAGACCAAGTTTTAACGACAATCAAG
TCTATTTGTTATCATAATCGTTCGATTCGTTTTTATCTGATTCATAGCGATTTTCCAAATGAATGGATTAAGCAATTAAA
TAAGCGCTTAGAGAAGTTTGACTCAGAAATTATTAATTGTCGGGTAACTTCTGAGCAAATTTCATGTTATAAATCGGATA
TTAGTTACACAGTCTTTTTACGCTATTTCATAGCTGATTTCGTGCAAGAAGACAAGGCCCTCTACTTGGACTGTGATCTA
GTTGTAACGAAAAATCTGGATGACTTGTTTGCTACAGACTTACAAGATTATCGTTTGGCTGCTGTTAGAGATTTTGGGGG
CAGAGCTTATTTTGGTCAAGAAATCTTTAATGCCGGTGTTCTCTTGGTAAACAATGCTTTTTGGAAAAAAGAGAATATGA
TCCAAAAATTAATTGATGTAACCAATGAATGGCATGATAAGGTGGATCAGGCAGATCAGAGCATCTTGAATATGCTTTTT
GAACATAAATGGTTGGAATTGGACTTTGATTATAATCATATTGTCATTCATAAACAGTTTGCTGATTATCAATTGCCTGA
GGGTCAGGATTATCCTGCTATTATTCACTATCTTTCTCATCGGAAACCGTGGAAAGATTTGGCGGCCCAAACCTATCGTG
AAGTTTGGTGGTACTATCATGGGCTTGAATGGACAGAATTGGGACAAAACCATCATTTACATCCATTACAAAGATCTCAC
ATCTATCCAATAAAGGAACCTTTCACTTGTCTAATCTATACTGCCTCAGACCATATTGAACAAATTGAGACATTGGTTCA
ATCCTTGCCTGATATTCAGTTTAAGATAGCAGCTAGAGTAATAGTTAGTGATCGATTGGCTCAGATGACAATTTATCCAA
ACGTGACTATATTTAACGGAATTCACTATTTGGTAGATGTCGATAATGAATTGGTAGAAACCAGTCAAGTACTTTTAGAT
ATTAATCATGGTGAAAAAACAGAGGAAATTATCAATCAATTTGCAAGACTTGGAAAAACTATTTTGTCCTTTGAAAATAC
CAAAACCTATGAAGCAGGTCAGGAGGCATATGCTGTTGACCAAGTTCAAGCAATGATTGAAAAATTAAGAGAAATAAGTA
AATGA

Upstream 100 bases:

>100_bases
ATTGGTTGCGAAACGCCGTAAACGTGATGAAGAAGAGTAAGACAACCTGTAAAGTTAGGCTAAACTAACTCGCGCACATA
AATCAAGGAGAAAATTGCTA

Downstream 100 bases:

>100_bases
AGAAAAATCATTTAGTAGGAGATGCTCTGATTTTGACGGTTAGTGATCAGATTGAAGAGTTGGATTATTTTTTATAAAAT
TTCTCCGTTCATCATATATG

Product: glycosyl transferase

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 694; Mature: 694

Protein sequence:

>694_residues
MDDKITVIVPVYNVENYLRKCLDSIITQTYKNIEIVVVNDGSTDASGEICKEFSEMDHRILYIEQENAGLSAARNTGLNN
MSGNYVTFVDSDDWIELDYVETLYKEITEYQADIAVGNYYSFNESEGMFYFHISGDSYYEKVYDNVSIFENLYETQEMRS
FALISAWGKLYKARLFEQLRFDMGKLGEDGYLNQKVYLLSEKVIYLNKSLYAYRIRKGSLSRIWTEKWMHALVDAMSERI
TLLANMGYPLEKHLAIYRQMLEFSLSNGQASGLSDTATYKEFEMKQRLLNQLSRQEESEKKAIVLAANYAYVDQVLTTIK
SICYHNRSIRFYLIHSDFPNEWIKQLNKRLEKFDSEIINCRVTSEQISCYKSDISYTVFLRYFIADFVQEDKALYLDCDL
VVTKNLDDLFATDLQDYRLAAVRDFGGRAYFGQEIFNAGVLLVNNAFWKKENMIQKLIDVTNEWHDKVDQADQSILNMLF
EHKWLELDFDYNHIVIHKQFADYQLPEGQDYPAIIHYLSHRKPWKDLAAQTYREVWWYYHGLEWTELGQNHHLHPLQRSH
IYPIKEPFTCLIYTASDHIEQIETLVQSLPDIQFKIAARVIVSDRLAQMTIYPNVTIFNGIHYLVDVDNELVETSQVLLD
INHGEKTEEIINQFARLGKTILSFENTKTYEAGQEAYAVDQVQAMIEKLREISK

Sequences:

>Translated_694_residues
MDDKITVIVPVYNVENYLRKCLDSIITQTYKNIEIVVVNDGSTDASGEICKEFSEMDHRILYIEQENAGLSAARNTGLNN
MSGNYVTFVDSDDWIELDYVETLYKEITEYQADIAVGNYYSFNESEGMFYFHISGDSYYEKVYDNVSIFENLYETQEMRS
FALISAWGKLYKARLFEQLRFDMGKLGEDGYLNQKVYLLSEKVIYLNKSLYAYRIRKGSLSRIWTEKWMHALVDAMSERI
TLLANMGYPLEKHLAIYRQMLEFSLSNGQASGLSDTATYKEFEMKQRLLNQLSRQEESEKKAIVLAANYAYVDQVLTTIK
SICYHNRSIRFYLIHSDFPNEWIKQLNKRLEKFDSEIINCRVTSEQISCYKSDISYTVFLRYFIADFVQEDKALYLDCDL
VVTKNLDDLFATDLQDYRLAAVRDFGGRAYFGQEIFNAGVLLVNNAFWKKENMIQKLIDVTNEWHDKVDQADQSILNMLF
EHKWLELDFDYNHIVIHKQFADYQLPEGQDYPAIIHYLSHRKPWKDLAAQTYREVWWYYHGLEWTELGQNHHLHPLQRSH
IYPIKEPFTCLIYTASDHIEQIETLVQSLPDIQFKIAARVIVSDRLAQMTIYPNVTIFNGIHYLVDVDNELVETSQVLLD
INHGEKTEEIINQFARLGKTILSFENTKTYEAGQEAYAVDQVQAMIEKLREISK
>Mature_694_residues
MDDKITVIVPVYNVENYLRKCLDSIITQTYKNIEIVVVNDGSTDASGEICKEFSEMDHRILYIEQENAGLSAARNTGLNN
MSGNYVTFVDSDDWIELDYVETLYKEITEYQADIAVGNYYSFNESEGMFYFHISGDSYYEKVYDNVSIFENLYETQEMRS
FALISAWGKLYKARLFEQLRFDMGKLGEDGYLNQKVYLLSEKVIYLNKSLYAYRIRKGSLSRIWTEKWMHALVDAMSERI
TLLANMGYPLEKHLAIYRQMLEFSLSNGQASGLSDTATYKEFEMKQRLLNQLSRQEESEKKAIVLAANYAYVDQVLTTIK
SICYHNRSIRFYLIHSDFPNEWIKQLNKRLEKFDSEIINCRVTSEQISCYKSDISYTVFLRYFIADFVQEDKALYLDCDL
VVTKNLDDLFATDLQDYRLAAVRDFGGRAYFGQEIFNAGVLLVNNAFWKKENMIQKLIDVTNEWHDKVDQADQSILNMLF
EHKWLELDFDYNHIVIHKQFADYQLPEGQDYPAIIHYLSHRKPWKDLAAQTYREVWWYYHGLEWTELGQNHHLHPLQRSH
IYPIKEPFTCLIYTASDHIEQIETLVQSLPDIQFKIAARVIVSDRLAQMTIYPNVTIFNGIHYLVDVDNELVETSQVLLD
INHGEKTEEIINQFARLGKTILSFENTKTYEAGQEAYAVDQVQAMIEKLREISK

Specific function: May be involved in the production of the exopolysaccharide (EPS) component of the extracellular matrix during biofilm formation. EPS is responsible for the adhesion of chains of cells into bundles. Required for biofilm maintenance [H]

COG id: COG1442

COG function: function code M; Lipopolysaccharide biosynthesis proteins, LPS:glycosyltransferases

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the glycosyltransferase 2 family [H]

Homologues:

Organism=Escherichia coli, GI1790044, Length=229, Percent_Identity=30.5676855895196, Blast_Score=100, Evalue=2e-22,
Organism=Escherichia coli, GI1790057, Length=176, Percent_Identity=30.6818181818182, Blast_Score=72, Evalue=1e-13,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR001173 [H]

Pfam domain/function: PF00535 Glycos_transf_2 [H]

EC number: 2.-.-.- [C]

Molecular weight: Translated: 81327; Mature: 81327

Theoretical pI: Translated: 4.84; Mature: 4.84

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.0 %Cys     (Translated Protein)
2.2 %Met     (Translated Protein)
3.2 %Cys+Met (Translated Protein)
1.0 %Cys     (Mature Protein)
2.2 %Met     (Mature Protein)
3.2 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MDDKITVIVPVYNVENYLRKCLDSIITQTYKNIEIVVVNDGSTDASGEICKEFSEMDHRI
CCCCEEEEEEECCHHHHHHHHHHHHHHHHHCCEEEEEEECCCCCCCHHHHHHHHHCCCEE
LYIEQENAGLSAARNTGLNNMSGNYVTFVDSDDWIELDYVETLYKEITEYQADIAVGNYY
EEEEECCCCCHHHHCCCCCCCCCCEEEEECCCCCEEHHHHHHHHHHHHHHHHHEEECCEE
SFNESEGMFYFHISGDSYYEKVYDNVSIFENLYETQEMRSFALISAWGKLYKARLFEQLR
EECCCCCEEEEEECCCHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
FDMGKLGEDGYLNQKVYLLSEKVIYLNKSLYAYRIRKGSLSRIWTEKWMHALVDAMSERI
HHHHCCCCCCCCCCEEEEEECEEEEEECCEEEEEECCCCHHHHHHHHHHHHHHHHHHHHH
TLLANMGYPLEKHLAIYRQMLEFSLSNGQASGLSDTATYKEFEMKQRLLNQLSRQEESEK
HHHHCCCCCHHHHHHHHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHHHCCCCCC
KAIVLAANYAYVDQVLTTIKSICYHNRSIRFYLIHSDFPNEWIKQLNKRLEKFDSEIINC
CEEEEEECHHHHHHHHHHHHHHHHCCCCEEEEEEECCCCHHHHHHHHHHHHHHHHHHEEE
RVTSEQISCYKSDISYTVFLRYFIADFVQEDKALYLDCDLVVTKNLDDLFATDLQDYRLA
EEEHHHHHHHHHCCHHHHHHHHHHHHHHCCCCEEEEEEEEEEECCCHHHHHCCHHHHHHH
AVRDFGGRAYFGQEIFNAGVLLVNNAFWKKENMIQKLIDVTNEWHDKVDQADQSILNMLF
HHHHCCCCCHHHHHHHCCCEEEEECCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
EHKWLELDFDYNHIVIHKQFADYQLPEGQDYPAIIHYLSHRKPWKDLAAQTYREVWWYYH
HCCCEEEECCCCEEEEEEECCCCCCCCCCCCHHHHHHHHCCCCHHHHHHHHHHHHHHHHC
GLEWTELGQNHHLHPLQRSHIYPIKEPFTCLIYTASDHIEQIETLVQSLPDIQFKIAARV
CCCHHHCCCCCCCCCCCCCCCCCCCCCCEEEEEECHHHHHHHHHHHHHCCCCEEHHHHHH
IVSDRLAQMTIYPNVTIFNGIHYLVDVDNELVETSQVLLDINHGEKTEEIINQFARLGKT
HHHHHHHEEEECCCEEEECCEEEEEECCHHHHHHHHHEEECCCCCHHHHHHHHHHHHHHH
ILSFENTKTYEAGQEAYAVDQVQAMIEKLREISK
HHHCCCCCCHHCCCHHHHHHHHHHHHHHHHHHCC
>Mature Secondary Structure
MDDKITVIVPVYNVENYLRKCLDSIITQTYKNIEIVVVNDGSTDASGEICKEFSEMDHRI
CCCCEEEEEEECCHHHHHHHHHHHHHHHHHCCEEEEEEECCCCCCCHHHHHHHHHCCCEE
LYIEQENAGLSAARNTGLNNMSGNYVTFVDSDDWIELDYVETLYKEITEYQADIAVGNYY
EEEEECCCCCHHHHCCCCCCCCCCEEEEECCCCCEEHHHHHHHHHHHHHHHHHEEECCEE
SFNESEGMFYFHISGDSYYEKVYDNVSIFENLYETQEMRSFALISAWGKLYKARLFEQLR
EECCCCCEEEEEECCCHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
FDMGKLGEDGYLNQKVYLLSEKVIYLNKSLYAYRIRKGSLSRIWTEKWMHALVDAMSERI
HHHHCCCCCCCCCCEEEEEECEEEEEECCEEEEEECCCCHHHHHHHHHHHHHHHHHHHHH
TLLANMGYPLEKHLAIYRQMLEFSLSNGQASGLSDTATYKEFEMKQRLLNQLSRQEESEK
HHHHCCCCCHHHHHHHHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHHHCCCCCC
KAIVLAANYAYVDQVLTTIKSICYHNRSIRFYLIHSDFPNEWIKQLNKRLEKFDSEIINC
CEEEEEECHHHHHHHHHHHHHHHHCCCCEEEEEEECCCCHHHHHHHHHHHHHHHHHHEEE
RVTSEQISCYKSDISYTVFLRYFIADFVQEDKALYLDCDLVVTKNLDDLFATDLQDYRLA
EEEHHHHHHHHHCCHHHHHHHHHHHHHHCCCCEEEEEEEEEEECCCHHHHHCCHHHHHHH
AVRDFGGRAYFGQEIFNAGVLLVNNAFWKKENMIQKLIDVTNEWHDKVDQADQSILNMLF
HHHHCCCCCHHHHHHHCCCEEEEECCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
EHKWLELDFDYNHIVIHKQFADYQLPEGQDYPAIIHYLSHRKPWKDLAAQTYREVWWYYH
HCCCEEEECCCCEEEEEEECCCCCCCCCCCCHHHHHHHHCCCCHHHHHHHHHHHHHHHHC
GLEWTELGQNHHLHPLQRSHIYPIKEPFTCLIYTASDHIEQIETLVQSLPDIQFKIAARV
CCCHHHCCCCCCCCCCCCCCCCCCCCCCEEEEEECHHHHHHHHHHHHHCCCCEEHHHHHH
IVSDRLAQMTIYPNVTIFNGIHYLVDVDNELVETSQVLLDINHGEKTEEIINQFARLGKT
HHHHHHHEEEECCCEEEECCEEEEEECCHHHHHHHHHEEECCCCCHHHHHHHHHHHHHHH
ILSFENTKTYEAGQEAYAVDQVQAMIEKLREISK
HHHCCCCCCHHCCCHHHHHHHHHHHHHHHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 8969506; 9384377 [H]