Definition Thermus thermophilus HB8 chromosome, complete genome.
Accession NC_006461
Length 1,849,742

Click here to switch to the map view.

The map label for this gene is epsD [H]

Identifier: 55980612

GI number: 55980612

Start: 611245

End: 612339

Strand: Reverse

Name: epsD [H]

Synonym: TTHA0643

Alternate gene names: 55980612

Gene position: 612339-611245 (Counterclockwise)

Preceding gene: 55980613

Following gene: 55980611

Centisome position: 33.1

GC content: 68.68

Gene sequence:

>1095_bases
ATGCGCCTCCTCTACCTCATCACTCGCGCTGAACCCGGGGGAGCCCAGGTCCACCTCCTGGAACTCCTCCGAGGCTTCCG
GGACCGGGCGGAGCTCCACCTGGGGGTGGGGGAGGACCAAGACGGCTTCCTGGTGGAGGAAGCCCGCGCCCTGGGGGTGA
GGGTCCACCTCCTTAGGCACCTCGTGCAGCCCGTGCGCCCTGTAAAGGACTTTCTCGGCCTCTTTGAAGTAATGGCTCTC
ATCCGGAAAGTCCGGCCCCACCTCCTCCACGCCCACTCCTCCAAGGCGGGCTTCCTGGGGCGCCTGGCGGGGCGGGTCCT
GGGGGTGAAGAGCGTCTTCACGGCCCACGGGTGGGCCTTCACCGACGGGGTTCCAGAAGGAAGAAAGAGGCTCGCCCTCG
CCATGGAGCGCCTGGCGGGGCGGCTTGGGGACCTGGTCCTCGCCGTCTCCGAGTACGACAGGGCCCTCGCCCTTCGCCAC
AAGGCGGTGCCCCCGGAGAGGATCCGGGTGGTGCATAACGGGGTCCCCGATACCCCCTTCCGCGCAGACCCCAGGAAGGA
ACCGCCAAGGCTCGCCATGGTGGCCCGCTTCGCCCCTCAAAAGGACCACGCCCTCCTTCTAAAGGCCCTCTCGGGCCTAA
AGGAGCTTCCCTGGAGCCTGGACCTGGTGGGGGAGGGGCCCCTCCTTCCCCAAGCTAAGGCCCTAGCCGAGGCCCTGGGG
CTTGGCGAAAGGGTCCGCTTCCTAGGAAAGCGGCTGGACGTGGACCGGGTTCTGGCGGAGGCCCAGGTCTTCGTCCTCGC
CACGAACTGGGAGGGGCTTCCCCTTTCCGTACTCGAGGCCATGCGGGCCGGGCTTCCCGTGGTGGCCACGGGCATGGGCG
GGGTGGGAGAGGCGGTGGTGGAGGGAAAGACGGGGTTCCTGGTAGGGCGGGGGGACGAGGAAGCCCTAAGAGCGAGGCTG
AGAACCCTCCTCCTCTCCCCGGAACTCCGGGCCCGGCTGGGGGAAGCGGGGAGGAGGCGCTACGAGGAGGCCTTCACTCT
AGATGGCATGCTCGCCCGGGTGTGGGCGGCCTACGAGGAGGTGCTCCGCCTATAG

Upstream 100 bases:

>100_bases
AATATTGGGGCCAACACTCGTTTGCGACTCCTACCGTGGTCCACTCTGCTTGTTTGGATAGCTCTCCAGCTAGAAATCCA
GCTAGAAAGAAGGAGAAAGC

Downstream 100 bases:

>100_bases
GGAAGCCCATTTGCACGCCTCCCTCATTCCCCTCCTGGTAGGATGAAGGCCATGGGTGCGTTGGAGCTCCGGTTGCCCTA
CCGCACCGTTAAAGCCCGCC

Product: glycosyltransferase

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 364; Mature: 364

Protein sequence:

>364_residues
MRLLYLITRAEPGGAQVHLLELLRGFRDRAELHLGVGEDQDGFLVEEARALGVRVHLLRHLVQPVRPVKDFLGLFEVMAL
IRKVRPHLLHAHSSKAGFLGRLAGRVLGVKSVFTAHGWAFTDGVPEGRKRLALAMERLAGRLGDLVLAVSEYDRALALRH
KAVPPERIRVVHNGVPDTPFRADPRKEPPRLAMVARFAPQKDHALLLKALSGLKELPWSLDLVGEGPLLPQAKALAEALG
LGERVRFLGKRLDVDRVLAEAQVFVLATNWEGLPLSVLEAMRAGLPVVATGMGGVGEAVVEGKTGFLVGRGDEEALRARL
RTLLLSPELRARLGEAGRRRYEEAFTLDGMLARVWAAYEEVLRL

Sequences:

>Translated_364_residues
MRLLYLITRAEPGGAQVHLLELLRGFRDRAELHLGVGEDQDGFLVEEARALGVRVHLLRHLVQPVRPVKDFLGLFEVMAL
IRKVRPHLLHAHSSKAGFLGRLAGRVLGVKSVFTAHGWAFTDGVPEGRKRLALAMERLAGRLGDLVLAVSEYDRALALRH
KAVPPERIRVVHNGVPDTPFRADPRKEPPRLAMVARFAPQKDHALLLKALSGLKELPWSLDLVGEGPLLPQAKALAEALG
LGERVRFLGKRLDVDRVLAEAQVFVLATNWEGLPLSVLEAMRAGLPVVATGMGGVGEAVVEGKTGFLVGRGDEEALRARL
RTLLLSPELRARLGEAGRRRYEEAFTLDGMLARVWAAYEEVLRL
>Mature_364_residues
MRLLYLITRAEPGGAQVHLLELLRGFRDRAELHLGVGEDQDGFLVEEARALGVRVHLLRHLVQPVRPVKDFLGLFEVMAL
IRKVRPHLLHAHSSKAGFLGRLAGRVLGVKSVFTAHGWAFTDGVPEGRKRLALAMERLAGRLGDLVLAVSEYDRALALRH
KAVPPERIRVVHNGVPDTPFRADPRKEPPRLAMVARFAPQKDHALLLKALSGLKELPWSLDLVGEGPLLPQAKALAEALG
LGERVRFLGKRLDVDRVLAEAQVFVLATNWEGLPLSVLEAMRAGLPVVATGMGGVGEAVVEGKTGFLVGRGDEEALRARL
RTLLLSPELRARLGEAGRRRYEEAFTLDGMLARVWAAYEEVLRL

Specific function: May be involved in the production of the exopolysaccharide (EPS) component of the extracellular matrix during biofilm formation. EPS is responsible for the adhesion of chains of cells into bundles. Required for biofilm maintenance [H]

COG id: COG0438

COG function: function code M; Glycosyltransferase

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the glycosyltransferase 1 family [H]

Homologues:

Organism=Homo sapiens, GI11863130, Length=244, Percent_Identity=27.8688524590164, Blast_Score=77, Evalue=3e-14,
Organism=Escherichia coli, GI1788357, Length=185, Percent_Identity=32.4324324324324, Blast_Score=66, Evalue=3e-12,
Organism=Drosophila melanogaster, GI24654571, Length=232, Percent_Identity=26.2931034482759, Blast_Score=65, Evalue=6e-11,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR001296 [H]

Pfam domain/function: PF00534 Glycos_transf_1 [H]

EC number: 2.-.-.- [C]

Molecular weight: Translated: 40064; Mature: 40064

Theoretical pI: Translated: 10.64; Mature: 10.64

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.0 %Cys     (Translated Protein)
1.9 %Met     (Translated Protein)
1.9 %Cys+Met (Translated Protein)
0.0 %Cys     (Mature Protein)
1.9 %Met     (Mature Protein)
1.9 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MRLLYLITRAEPGGAQVHLLELLRGFRDRAELHLGVGEDQDGFLVEEARALGVRVHLLRH
CEEEEEEEECCCCCCHHHHHHHHHHHHHHHHEEECCCCCCCCCHHHHHHHHHHHHHHHHH
LVQPVRPVKDFLGLFEVMALIRKVRPHLLHAHSSKAGFLGRLAGRVLGVKSVFTAHGWAF
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHCCEEE
TDGVPEGRKRLALAMERLAGRLGDLVLAVSEYDRALALRHKAVPPERIRVVHNGVPDTPF
CCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHCCCCCCCCC
RADPRKEPPRLAMVARFAPQKDHALLLKALSGLKELPWSLDLVGEGPLLPQAKALAEALG
CCCCCCCCCHHHHHHHCCCCCHHHHHHHHHHHHHHCCCCEEECCCCCCCCHHHHHHHHHC
LGERVRFLGKRLDVDRVLAEAQVFVLATNWEGLPLSVLEAMRAGLPVVATGMGGVGEAVV
CHHHHHHHHHHCCHHHHHHHCEEEEEEECCCCCCHHHHHHHHCCCCEEEECCCCCCHHHC
EGKTGFLVGRGDEEALRARLRTLLLSPELRARLGEAGRRRYEEAFTLDGMLARVWAAYEE
CCCCEEEEECCCHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
VLRL
HHCC
>Mature Secondary Structure
MRLLYLITRAEPGGAQVHLLELLRGFRDRAELHLGVGEDQDGFLVEEARALGVRVHLLRH
CEEEEEEEECCCCCCHHHHHHHHHHHHHHHHEEECCCCCCCCCHHHHHHHHHHHHHHHHH
LVQPVRPVKDFLGLFEVMALIRKVRPHLLHAHSSKAGFLGRLAGRVLGVKSVFTAHGWAF
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHCCEEE
TDGVPEGRKRLALAMERLAGRLGDLVLAVSEYDRALALRHKAVPPERIRVVHNGVPDTPF
CCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHCCCCCCCCC
RADPRKEPPRLAMVARFAPQKDHALLLKALSGLKELPWSLDLVGEGPLLPQAKALAEALG
CCCCCCCCCHHHHHHHCCCCCHHHHHHHHHHHHHHCCCCEEECCCCCCCCHHHHHHHHHC
LGERVRFLGKRLDVDRVLAEAQVFVLATNWEGLPLSVLEAMRAGLPVVATGMGGVGEAVV
CHHHHHHHHHHCCHHHHHHHCEEEEEEECCCCCCHHHHHHHHCCCCEEEECCCCCCHHHC
EGKTGFLVGRGDEEALRARLRTLLLSPELRARLGEAGRRRYEEAFTLDGMLARVWAAYEE
CCCCEEEEECCCHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
VLRL
HHCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 8969506; 9384377 [H]