| Definition | Thermus thermophilus HB8 chromosome, complete genome. |
|---|---|
| Accession | NC_006461 |
| Length | 1,849,742 |
Click here to switch to the map view.
The map label for this gene is epsD [H]
Identifier: 55980612
GI number: 55980612
Start: 611245
End: 612339
Strand: Reverse
Name: epsD [H]
Synonym: TTHA0643
Alternate gene names: 55980612
Gene position: 612339-611245 (Counterclockwise)
Preceding gene: 55980613
Following gene: 55980611
Centisome position: 33.1
GC content: 68.68
Gene sequence:
>1095_bases ATGCGCCTCCTCTACCTCATCACTCGCGCTGAACCCGGGGGAGCCCAGGTCCACCTCCTGGAACTCCTCCGAGGCTTCCG GGACCGGGCGGAGCTCCACCTGGGGGTGGGGGAGGACCAAGACGGCTTCCTGGTGGAGGAAGCCCGCGCCCTGGGGGTGA GGGTCCACCTCCTTAGGCACCTCGTGCAGCCCGTGCGCCCTGTAAAGGACTTTCTCGGCCTCTTTGAAGTAATGGCTCTC ATCCGGAAAGTCCGGCCCCACCTCCTCCACGCCCACTCCTCCAAGGCGGGCTTCCTGGGGCGCCTGGCGGGGCGGGTCCT GGGGGTGAAGAGCGTCTTCACGGCCCACGGGTGGGCCTTCACCGACGGGGTTCCAGAAGGAAGAAAGAGGCTCGCCCTCG CCATGGAGCGCCTGGCGGGGCGGCTTGGGGACCTGGTCCTCGCCGTCTCCGAGTACGACAGGGCCCTCGCCCTTCGCCAC AAGGCGGTGCCCCCGGAGAGGATCCGGGTGGTGCATAACGGGGTCCCCGATACCCCCTTCCGCGCAGACCCCAGGAAGGA ACCGCCAAGGCTCGCCATGGTGGCCCGCTTCGCCCCTCAAAAGGACCACGCCCTCCTTCTAAAGGCCCTCTCGGGCCTAA AGGAGCTTCCCTGGAGCCTGGACCTGGTGGGGGAGGGGCCCCTCCTTCCCCAAGCTAAGGCCCTAGCCGAGGCCCTGGGG CTTGGCGAAAGGGTCCGCTTCCTAGGAAAGCGGCTGGACGTGGACCGGGTTCTGGCGGAGGCCCAGGTCTTCGTCCTCGC CACGAACTGGGAGGGGCTTCCCCTTTCCGTACTCGAGGCCATGCGGGCCGGGCTTCCCGTGGTGGCCACGGGCATGGGCG GGGTGGGAGAGGCGGTGGTGGAGGGAAAGACGGGGTTCCTGGTAGGGCGGGGGGACGAGGAAGCCCTAAGAGCGAGGCTG AGAACCCTCCTCCTCTCCCCGGAACTCCGGGCCCGGCTGGGGGAAGCGGGGAGGAGGCGCTACGAGGAGGCCTTCACTCT AGATGGCATGCTCGCCCGGGTGTGGGCGGCCTACGAGGAGGTGCTCCGCCTATAG
Upstream 100 bases:
>100_bases AATATTGGGGCCAACACTCGTTTGCGACTCCTACCGTGGTCCACTCTGCTTGTTTGGATAGCTCTCCAGCTAGAAATCCA GCTAGAAAGAAGGAGAAAGC
Downstream 100 bases:
>100_bases GGAAGCCCATTTGCACGCCTCCCTCATTCCCCTCCTGGTAGGATGAAGGCCATGGGTGCGTTGGAGCTCCGGTTGCCCTA CCGCACCGTTAAAGCCCGCC
Product: glycosyltransferase
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 364; Mature: 364
Protein sequence:
>364_residues MRLLYLITRAEPGGAQVHLLELLRGFRDRAELHLGVGEDQDGFLVEEARALGVRVHLLRHLVQPVRPVKDFLGLFEVMAL IRKVRPHLLHAHSSKAGFLGRLAGRVLGVKSVFTAHGWAFTDGVPEGRKRLALAMERLAGRLGDLVLAVSEYDRALALRH KAVPPERIRVVHNGVPDTPFRADPRKEPPRLAMVARFAPQKDHALLLKALSGLKELPWSLDLVGEGPLLPQAKALAEALG LGERVRFLGKRLDVDRVLAEAQVFVLATNWEGLPLSVLEAMRAGLPVVATGMGGVGEAVVEGKTGFLVGRGDEEALRARL RTLLLSPELRARLGEAGRRRYEEAFTLDGMLARVWAAYEEVLRL
Sequences:
>Translated_364_residues MRLLYLITRAEPGGAQVHLLELLRGFRDRAELHLGVGEDQDGFLVEEARALGVRVHLLRHLVQPVRPVKDFLGLFEVMAL IRKVRPHLLHAHSSKAGFLGRLAGRVLGVKSVFTAHGWAFTDGVPEGRKRLALAMERLAGRLGDLVLAVSEYDRALALRH KAVPPERIRVVHNGVPDTPFRADPRKEPPRLAMVARFAPQKDHALLLKALSGLKELPWSLDLVGEGPLLPQAKALAEALG LGERVRFLGKRLDVDRVLAEAQVFVLATNWEGLPLSVLEAMRAGLPVVATGMGGVGEAVVEGKTGFLVGRGDEEALRARL RTLLLSPELRARLGEAGRRRYEEAFTLDGMLARVWAAYEEVLRL >Mature_364_residues MRLLYLITRAEPGGAQVHLLELLRGFRDRAELHLGVGEDQDGFLVEEARALGVRVHLLRHLVQPVRPVKDFLGLFEVMAL IRKVRPHLLHAHSSKAGFLGRLAGRVLGVKSVFTAHGWAFTDGVPEGRKRLALAMERLAGRLGDLVLAVSEYDRALALRH KAVPPERIRVVHNGVPDTPFRADPRKEPPRLAMVARFAPQKDHALLLKALSGLKELPWSLDLVGEGPLLPQAKALAEALG LGERVRFLGKRLDVDRVLAEAQVFVLATNWEGLPLSVLEAMRAGLPVVATGMGGVGEAVVEGKTGFLVGRGDEEALRARL RTLLLSPELRARLGEAGRRRYEEAFTLDGMLARVWAAYEEVLRL
Specific function: May be involved in the production of the exopolysaccharide (EPS) component of the extracellular matrix during biofilm formation. EPS is responsible for the adhesion of chains of cells into bundles. Required for biofilm maintenance [H]
COG id: COG0438
COG function: function code M; Glycosyltransferase
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the glycosyltransferase 1 family [H]
Homologues:
Organism=Homo sapiens, GI11863130, Length=244, Percent_Identity=27.8688524590164, Blast_Score=77, Evalue=3e-14, Organism=Escherichia coli, GI1788357, Length=185, Percent_Identity=32.4324324324324, Blast_Score=66, Evalue=3e-12, Organism=Drosophila melanogaster, GI24654571, Length=232, Percent_Identity=26.2931034482759, Blast_Score=65, Evalue=6e-11,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR001296 [H]
Pfam domain/function: PF00534 Glycos_transf_1 [H]
EC number: 2.-.-.- [C]
Molecular weight: Translated: 40064; Mature: 40064
Theoretical pI: Translated: 10.64; Mature: 10.64
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.0 %Cys (Translated Protein) 1.9 %Met (Translated Protein) 1.9 %Cys+Met (Translated Protein) 0.0 %Cys (Mature Protein) 1.9 %Met (Mature Protein) 1.9 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MRLLYLITRAEPGGAQVHLLELLRGFRDRAELHLGVGEDQDGFLVEEARALGVRVHLLRH CEEEEEEEECCCCCCHHHHHHHHHHHHHHHHEEECCCCCCCCCHHHHHHHHHHHHHHHHH LVQPVRPVKDFLGLFEVMALIRKVRPHLLHAHSSKAGFLGRLAGRVLGVKSVFTAHGWAF HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHCCEEE TDGVPEGRKRLALAMERLAGRLGDLVLAVSEYDRALALRHKAVPPERIRVVHNGVPDTPF CCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHCCCCCCCCC RADPRKEPPRLAMVARFAPQKDHALLLKALSGLKELPWSLDLVGEGPLLPQAKALAEALG CCCCCCCCCHHHHHHHCCCCCHHHHHHHHHHHHHHCCCCEEECCCCCCCCHHHHHHHHHC LGERVRFLGKRLDVDRVLAEAQVFVLATNWEGLPLSVLEAMRAGLPVVATGMGGVGEAVV CHHHHHHHHHHCCHHHHHHHCEEEEEEECCCCCCHHHHHHHHCCCCEEEECCCCCCHHHC EGKTGFLVGRGDEEALRARLRTLLLSPELRARLGEAGRRRYEEAFTLDGMLARVWAAYEE CCCCEEEEECCCHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH VLRL HHCC >Mature Secondary Structure MRLLYLITRAEPGGAQVHLLELLRGFRDRAELHLGVGEDQDGFLVEEARALGVRVHLLRH CEEEEEEEECCCCCCHHHHHHHHHHHHHHHHEEECCCCCCCCCHHHHHHHHHHHHHHHHH LVQPVRPVKDFLGLFEVMALIRKVRPHLLHAHSSKAGFLGRLAGRVLGVKSVFTAHGWAF HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHCCEEE TDGVPEGRKRLALAMERLAGRLGDLVLAVSEYDRALALRHKAVPPERIRVVHNGVPDTPF CCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHCCCCCCCCC RADPRKEPPRLAMVARFAPQKDHALLLKALSGLKELPWSLDLVGEGPLLPQAKALAEALG CCCCCCCCCHHHHHHHCCCCCHHHHHHHHHHHHHHCCCCEEECCCCCCCCHHHHHHHHHC LGERVRFLGKRLDVDRVLAEAQVFVLATNWEGLPLSVLEAMRAGLPVVATGMGGVGEAVV CHHHHHHHHHHCCHHHHHHHCEEEEEEECCCCCCHHHHHHHHCCCCEEEECCCCCCHHHC EGKTGFLVGRGDEEALRARLRTLLLSPELRARLGEAGRRRYEEAFTLDGMLARVWAAYEE CCCCEEEEECCCHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH VLRL HHCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 8969506; 9384377 [H]