| Definition | Streptococcus pneumoniae ATCC 700669, complete genome. |
|---|---|
| Accession | NC_011900 |
| Length | 2,221,315 |
Click here to switch to the map view.
The map label for this gene is epsH [H]
Identifier: 221232509
GI number: 221232509
Start: 1719298
End: 1721382
Strand: Reverse
Name: epsH [H]
Synonym: SPN23F_17810
Alternate gene names: 221232509
Gene position: 1721382-1719298 (Counterclockwise)
Preceding gene: 221232510
Following gene: 221232508
Centisome position: 77.49
GC content: 35.3
Gene sequence:
>2085_bases GTGGATGATAAAATAACGGTCATTGTACCAGTATACAATGTGGAAAACTATCTGAGGAAGTGCCTAGATAGTATTATTAC TCAAACATATAAAAATATTGAGATTGTTGTCGTTAATGATGGTTCTACGGATGCTTCAGGTGAAATTTGTAAAGAATTTT CAGAAATGGATCACCGAATTCTCTATATAGAACAAGAAAATGCTGGTCTTTCTGCCGCACGAAACACCGGTCTGAATAAT ATGTCCGGAAATTATGTGACCTTTGTGGACTCGGATGATTGGATTGAGTTAGATTATGTAGAAACCCTATATAAAGAAAT AACAGAATATCAAGCTGATATTGCAGTTGGGAATTACTATTCTTTCAACGAAAGTGAAGGAATGTTCTACTTTCATATAT CAGGAGACTCCTATTATGAGAAGGTATATGACAATGTTTCCATCTTTGAGAATTTGTATGAAACTCAAGAAATGAGGAGT TTCGCTTTGATATCTGCTTGGGGTAAACTCTATAAGGCGAGATTGTTTGAGCAGTTGCGCTTTGACATGGGTAAATTAGG AGAAGATGGTTACCTCAATCAAAAGGTATATTTATTATCAGAAAAGGTAATTTATTTAAATAAAAGTCTTTATGCTTATC GTATTAGAAAAGGTAGTCTATCAAGAATTTGGACAGAAAAGTGGATGCATGCATTGGTTGATGCCATGTCCGAACGCATT ACGCTACTAGCTAATATGGGTTACCCTTTAGAAAAGCATTTGGCGATTTATCGTCAAATGTTGGAATTCAGTCTCTCCAA CGGTCAAGCTAGCGGTTTATCTGACACAGCAACATATAAAGAGTTTGAAATGAAACAAAGGCTTTTAAATCAGCTATCGA GACAAGAGGAAAGTGAAAAGAAAGCCATTGTCCTAGCAGCAAATTATGCCTATGTAGACCAAGTTTTAACGACAATCAAG TCTATTTGTTATCATAATCGTTCGATTCGTTTTTATCTGATTCATAGCGATTTTCCAAATGAATGGATTAAGCAATTAAA TAAGCGCTTAGAGAAGTTTGACTCAGAAATTATTAATTGTCGGGTAACTTCTGAGCAAATTTCATGTTATAAATCGGATA TTAGTTACACAGTCTTTTTACGCTATTTCATAGCTGATTTCGTGCAAGAAGACAAGGCCCTCTACTTGGACTGTGATCTA GTTGTAACGAAAAATCTGGATGACTTGTTTGCTACAGACTTACAAGATTATCGTTTGGCTGCTGTTAGAGATTTTGGGGG CAGAGCTTATTTTGGTCAAGAAATCTTTAATGCCGGTGTTCTCTTGGTAAACAATGCTTTTTGGAAAAAAGAGAATATGA TCCAAAAATTAATTGATGTAACCAATGAATGGCATGATAAGGTGGATCAGGCAGATCAGAGCATCTTGAATATGCTTTTT GAACATAAATGGTTGGAATTGGACTTTGATTATAATCATATTGTCATTCATAAACAGTTTGCTGATTATCAATTGCCTGA GGGTCAGGATTATCCTGCTATTATTCACTATCTTTCTCATCGGAAACCGTGGAAAGATTTGGCGGCCCAAACCTATCGTG AAGTTTGGTGGTACTATCATGGGCTTGAATGGACAGAATTGGGACAAAACCATCATTTACATCCATTACAAAGATCTCAC ATCTATCCAATAAAGGAACCTTTCACTTGTCTAATCTATACTGCCTCAGACCATATTGAACAAATTGAGACATTGGTTCA ATCCTTGCCTGATATTCAGTTTAAGATAGCAGCTAGAGTAATAGTTAGTGATCGATTGGCTCAGATGACAATTTATCCAA ACGTGACTATATTTAACGGAATTCACTATTTGGTAGATGTCGATAATGAATTGGTAGAAACCAGTCAAGTACTTTTAGAT ATTAATCATGGTGAAAAAACAGAGGAAATTATCAATCAATTTGCAAGACTTGGAAAAACTATTTTGTCCTTTGAAAATAC CAAAACCTATGAAGCAGGTCAGGAGGCATATGCTGTTGACCAAGTTCAAGCAATGATTGAAAAATTAAGAGAAATAAGTA AATGA
Upstream 100 bases:
>100_bases ATTGGTTGCGAAACGCCGTAAACGTGATGAAGAAGAGTAAGACAACCTGTAAAGTTAGGCTAAACTAACTCGCGCACATA AATCAAGGAGAAAATTGCTA
Downstream 100 bases:
>100_bases AGAAAAATCATTTAGTAGGAGATGCTCTGATTTTGACGGTTAGTGATCAGATTGAAGAGTTGGATTATTTTTTATAAAAT TTCTCCGTTCATCATATATG
Product: glycosyl transferase
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 694; Mature: 694
Protein sequence:
>694_residues MDDKITVIVPVYNVENYLRKCLDSIITQTYKNIEIVVVNDGSTDASGEICKEFSEMDHRILYIEQENAGLSAARNTGLNN MSGNYVTFVDSDDWIELDYVETLYKEITEYQADIAVGNYYSFNESEGMFYFHISGDSYYEKVYDNVSIFENLYETQEMRS FALISAWGKLYKARLFEQLRFDMGKLGEDGYLNQKVYLLSEKVIYLNKSLYAYRIRKGSLSRIWTEKWMHALVDAMSERI TLLANMGYPLEKHLAIYRQMLEFSLSNGQASGLSDTATYKEFEMKQRLLNQLSRQEESEKKAIVLAANYAYVDQVLTTIK SICYHNRSIRFYLIHSDFPNEWIKQLNKRLEKFDSEIINCRVTSEQISCYKSDISYTVFLRYFIADFVQEDKALYLDCDL VVTKNLDDLFATDLQDYRLAAVRDFGGRAYFGQEIFNAGVLLVNNAFWKKENMIQKLIDVTNEWHDKVDQADQSILNMLF EHKWLELDFDYNHIVIHKQFADYQLPEGQDYPAIIHYLSHRKPWKDLAAQTYREVWWYYHGLEWTELGQNHHLHPLQRSH IYPIKEPFTCLIYTASDHIEQIETLVQSLPDIQFKIAARVIVSDRLAQMTIYPNVTIFNGIHYLVDVDNELVETSQVLLD INHGEKTEEIINQFARLGKTILSFENTKTYEAGQEAYAVDQVQAMIEKLREISK
Sequences:
>Translated_694_residues MDDKITVIVPVYNVENYLRKCLDSIITQTYKNIEIVVVNDGSTDASGEICKEFSEMDHRILYIEQENAGLSAARNTGLNN MSGNYVTFVDSDDWIELDYVETLYKEITEYQADIAVGNYYSFNESEGMFYFHISGDSYYEKVYDNVSIFENLYETQEMRS FALISAWGKLYKARLFEQLRFDMGKLGEDGYLNQKVYLLSEKVIYLNKSLYAYRIRKGSLSRIWTEKWMHALVDAMSERI TLLANMGYPLEKHLAIYRQMLEFSLSNGQASGLSDTATYKEFEMKQRLLNQLSRQEESEKKAIVLAANYAYVDQVLTTIK SICYHNRSIRFYLIHSDFPNEWIKQLNKRLEKFDSEIINCRVTSEQISCYKSDISYTVFLRYFIADFVQEDKALYLDCDL VVTKNLDDLFATDLQDYRLAAVRDFGGRAYFGQEIFNAGVLLVNNAFWKKENMIQKLIDVTNEWHDKVDQADQSILNMLF EHKWLELDFDYNHIVIHKQFADYQLPEGQDYPAIIHYLSHRKPWKDLAAQTYREVWWYYHGLEWTELGQNHHLHPLQRSH IYPIKEPFTCLIYTASDHIEQIETLVQSLPDIQFKIAARVIVSDRLAQMTIYPNVTIFNGIHYLVDVDNELVETSQVLLD INHGEKTEEIINQFARLGKTILSFENTKTYEAGQEAYAVDQVQAMIEKLREISK >Mature_694_residues MDDKITVIVPVYNVENYLRKCLDSIITQTYKNIEIVVVNDGSTDASGEICKEFSEMDHRILYIEQENAGLSAARNTGLNN MSGNYVTFVDSDDWIELDYVETLYKEITEYQADIAVGNYYSFNESEGMFYFHISGDSYYEKVYDNVSIFENLYETQEMRS FALISAWGKLYKARLFEQLRFDMGKLGEDGYLNQKVYLLSEKVIYLNKSLYAYRIRKGSLSRIWTEKWMHALVDAMSERI TLLANMGYPLEKHLAIYRQMLEFSLSNGQASGLSDTATYKEFEMKQRLLNQLSRQEESEKKAIVLAANYAYVDQVLTTIK SICYHNRSIRFYLIHSDFPNEWIKQLNKRLEKFDSEIINCRVTSEQISCYKSDISYTVFLRYFIADFVQEDKALYLDCDL VVTKNLDDLFATDLQDYRLAAVRDFGGRAYFGQEIFNAGVLLVNNAFWKKENMIQKLIDVTNEWHDKVDQADQSILNMLF EHKWLELDFDYNHIVIHKQFADYQLPEGQDYPAIIHYLSHRKPWKDLAAQTYREVWWYYHGLEWTELGQNHHLHPLQRSH IYPIKEPFTCLIYTASDHIEQIETLVQSLPDIQFKIAARVIVSDRLAQMTIYPNVTIFNGIHYLVDVDNELVETSQVLLD INHGEKTEEIINQFARLGKTILSFENTKTYEAGQEAYAVDQVQAMIEKLREISK
Specific function: May be involved in the production of the exopolysaccharide (EPS) component of the extracellular matrix during biofilm formation. EPS is responsible for the adhesion of chains of cells into bundles. Required for biofilm maintenance [H]
COG id: COG1442
COG function: function code M; Lipopolysaccharide biosynthesis proteins, LPS:glycosyltransferases
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the glycosyltransferase 2 family [H]
Homologues:
Organism=Escherichia coli, GI1790044, Length=229, Percent_Identity=30.5676855895196, Blast_Score=100, Evalue=2e-22, Organism=Escherichia coli, GI1790057, Length=176, Percent_Identity=30.6818181818182, Blast_Score=72, Evalue=1e-13,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR001173 [H]
Pfam domain/function: PF00535 Glycos_transf_2 [H]
EC number: 2.-.-.- [C]
Molecular weight: Translated: 81327; Mature: 81327
Theoretical pI: Translated: 4.84; Mature: 4.84
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.0 %Cys (Translated Protein) 2.2 %Met (Translated Protein) 3.2 %Cys+Met (Translated Protein) 1.0 %Cys (Mature Protein) 2.2 %Met (Mature Protein) 3.2 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MDDKITVIVPVYNVENYLRKCLDSIITQTYKNIEIVVVNDGSTDASGEICKEFSEMDHRI CCCCEEEEEEECCHHHHHHHHHHHHHHHHHCCEEEEEEECCCCCCCHHHHHHHHHCCCEE LYIEQENAGLSAARNTGLNNMSGNYVTFVDSDDWIELDYVETLYKEITEYQADIAVGNYY EEEEECCCCCHHHHCCCCCCCCCCEEEEECCCCCEEHHHHHHHHHHHHHHHHHEEECCEE SFNESEGMFYFHISGDSYYEKVYDNVSIFENLYETQEMRSFALISAWGKLYKARLFEQLR EECCCCCEEEEEECCCHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH FDMGKLGEDGYLNQKVYLLSEKVIYLNKSLYAYRIRKGSLSRIWTEKWMHALVDAMSERI HHHHCCCCCCCCCCEEEEEECEEEEEECCEEEEEECCCCHHHHHHHHHHHHHHHHHHHHH TLLANMGYPLEKHLAIYRQMLEFSLSNGQASGLSDTATYKEFEMKQRLLNQLSRQEESEK HHHHCCCCCHHHHHHHHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHHHCCCCCC KAIVLAANYAYVDQVLTTIKSICYHNRSIRFYLIHSDFPNEWIKQLNKRLEKFDSEIINC CEEEEEECHHHHHHHHHHHHHHHHCCCCEEEEEEECCCCHHHHHHHHHHHHHHHHHHEEE RVTSEQISCYKSDISYTVFLRYFIADFVQEDKALYLDCDLVVTKNLDDLFATDLQDYRLA EEEHHHHHHHHHCCHHHHHHHHHHHHHHCCCCEEEEEEEEEEECCCHHHHHCCHHHHHHH AVRDFGGRAYFGQEIFNAGVLLVNNAFWKKENMIQKLIDVTNEWHDKVDQADQSILNMLF HHHHCCCCCHHHHHHHCCCEEEEECCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH EHKWLELDFDYNHIVIHKQFADYQLPEGQDYPAIIHYLSHRKPWKDLAAQTYREVWWYYH HCCCEEEECCCCEEEEEEECCCCCCCCCCCCHHHHHHHHCCCCHHHHHHHHHHHHHHHHC GLEWTELGQNHHLHPLQRSHIYPIKEPFTCLIYTASDHIEQIETLVQSLPDIQFKIAARV CCCHHHCCCCCCCCCCCCCCCCCCCCCCEEEEEECHHHHHHHHHHHHHCCCCEEHHHHHH IVSDRLAQMTIYPNVTIFNGIHYLVDVDNELVETSQVLLDINHGEKTEEIINQFARLGKT HHHHHHHEEEECCCEEEECCEEEEEECCHHHHHHHHHEEECCCCCHHHHHHHHHHHHHHH ILSFENTKTYEAGQEAYAVDQVQAMIEKLREISK HHHCCCCCCHHCCCHHHHHHHHHHHHHHHHHHCC >Mature Secondary Structure MDDKITVIVPVYNVENYLRKCLDSIITQTYKNIEIVVVNDGSTDASGEICKEFSEMDHRI CCCCEEEEEEECCHHHHHHHHHHHHHHHHHCCEEEEEEECCCCCCCHHHHHHHHHCCCEE LYIEQENAGLSAARNTGLNNMSGNYVTFVDSDDWIELDYVETLYKEITEYQADIAVGNYY EEEEECCCCCHHHHCCCCCCCCCCEEEEECCCCCEEHHHHHHHHHHHHHHHHHEEECCEE SFNESEGMFYFHISGDSYYEKVYDNVSIFENLYETQEMRSFALISAWGKLYKARLFEQLR EECCCCCEEEEEECCCHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH FDMGKLGEDGYLNQKVYLLSEKVIYLNKSLYAYRIRKGSLSRIWTEKWMHALVDAMSERI HHHHCCCCCCCCCCEEEEEECEEEEEECCEEEEEECCCCHHHHHHHHHHHHHHHHHHHHH TLLANMGYPLEKHLAIYRQMLEFSLSNGQASGLSDTATYKEFEMKQRLLNQLSRQEESEK HHHHCCCCCHHHHHHHHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHHHCCCCCC KAIVLAANYAYVDQVLTTIKSICYHNRSIRFYLIHSDFPNEWIKQLNKRLEKFDSEIINC CEEEEEECHHHHHHHHHHHHHHHHCCCCEEEEEEECCCCHHHHHHHHHHHHHHHHHHEEE RVTSEQISCYKSDISYTVFLRYFIADFVQEDKALYLDCDLVVTKNLDDLFATDLQDYRLA EEEHHHHHHHHHCCHHHHHHHHHHHHHHCCCCEEEEEEEEEEECCCHHHHHCCHHHHHHH AVRDFGGRAYFGQEIFNAGVLLVNNAFWKKENMIQKLIDVTNEWHDKVDQADQSILNMLF HHHHCCCCCHHHHHHHCCCEEEEECCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH EHKWLELDFDYNHIVIHKQFADYQLPEGQDYPAIIHYLSHRKPWKDLAAQTYREVWWYYH HCCCEEEECCCCEEEEEEECCCCCCCCCCCCHHHHHHHHCCCCHHHHHHHHHHHHHHHHC GLEWTELGQNHHLHPLQRSHIYPIKEPFTCLIYTASDHIEQIETLVQSLPDIQFKIAARV CCCHHHCCCCCCCCCCCCCCCCCCCCCCEEEEEECHHHHHHHHHHHHHCCCCEEHHHHHH IVSDRLAQMTIYPNVTIFNGIHYLVDVDNELVETSQVLLDINHGEKTEEIINQFARLGKT HHHHHHHEEEECCCEEEECCEEEEEECCHHHHHHHHHEEECCCCCHHHHHHHHHHHHHHH ILSFENTKTYEAGQEAYAVDQVQAMIEKLREISK HHHCCCCCCHHCCCHHHHHHHHHHHHHHHHHHCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 8969506; 9384377 [H]