Definition Thermoanaerobacter tengcongensis MB4, complete genome.
Accession NC_003869
Length 2,689,445

Click here to switch to the map view.

The map label for this gene is RfaG3 [C]

Identifier: 20807005

GI number: 20807005

Start: 510654

End: 512324

Strand: Direct

Name: RfaG3 [C]

Synonym: TTE0500

Alternate gene names: 20807005

Gene position: 510654-512324 (Clockwise)

Preceding gene: 20807004

Following gene: 20807006

Centisome position: 18.99

GC content: 32.08

Gene sequence:

>1671_bases
ATGCCAACGTCTTGGTACAACGTAATACCGGAAATATTGAGTTTAATCGAAAAACATAAACCTCGTAGTATTTTAGACGT
AGGTATAGGTTTTGGTAAATATGGAGTTTTGATAAGGGAAGTGTTAGAATTACCCTATGAACGATACGATAAATTAAAAT
GGCAGCATAGAGTTGAGGGAGTAGAGGTCTTTGAAGGATATAAAAATCCTCTTCATACTTATGCTTATGATAAAGTGTAT
TATAGCAATATTTTAGATGTAATTGATAAACTTCCACAATATGATGTAATATTGCTTATTGATGTATTAGAGCATTTTAC
AAAAGAAGAAGGTTATCTTTTATTAGATAAACTGCTTGAACATACCAAAAATTTTATTTTAATTTCTACTCCATTATACC
CCGATATTCAGAAAGATTATGAAGGTAACCCTCATGAAGAGCATAAAAGCAGATGGTCAATAATTGATTTTGTAGATTAC
GATTATAGCTTTAAACTTATTCCTATTGGGAATAATGGTGCACAACTATTTACTATTTTTCCTACAGCACAAGGTGTTAA
AGAAAAGATTAATACTCATCTATATACACAAATCATTGAAAACAATTCTTTAAATGCAAAACCCAAATTAAAAATAGGTT
ATTTATTACCTCACAAAAATTTGACAGGCGGTTTAAAAATGCTTTTAGAGAATATGAGATATATGAAGAAAAGAGGTCAT
ACAATTTGTGGTTTTTTGAAAAGCGATACAAATGATGATGTAATTCCTAATTGGTATAGAGATATTGAAATAGATGAAAA
AATAATATTACCACATAAAGACAGTTTCTCTTATTATATAGAAGATTGCGATATAGTAATTGCTGGTTGGTTGGGACAAC
TTATAGAATTAAAGAGGAACAAGATTCACGTAATATACTGGGAGCAAGGGAGTGAATGGTTGTTTGGTGATTATAGAGAT
TTGTCACCAAATTCAAAAATCAGAGAACACTTAAAAGAGTGTTTTTCTTCTGATGTAACTTTTGTGAGTGCTTCACCTTT
AATTGCAAAGGTATTGAAGGTGAGGTATGGAAAAGATTCGACAATAATTCCGAATGGCATTGACACGACTTTTTATTTTC
CGAGGAAAAAAGAAAAGAGTAGCCAAGATATTTCTATTTTGTTAGTAGGTCACCCGTACCTTTGGTTTAAAGGTTTTGAA
GTGGCTCTTATTGCGTTGGAGATGGTGTGGAGAAAAGGATACAGATTCAACGTAAATTGGGTATGTCAAGAACTACCTAA
TGTTAAAAATCTTAGCTATCCCATTAATTTCATTAAAAAGCCAAGTCAAGAAGAATTAGCTGAAATTTATAGAAATTCTG
ATATGCTAGTGTTTACATCGTGGTATGAGGGTTTTGGTATGCCACCTCTTGAGGCTATGGCATCAGGTATTCCTGTGATA
TCCACTAGGTGTGGGGGCGTTGAAAGTTTTATAACTCCAGGAGTAAATGGAATTTTAGTGGAACCAGGAGATATAGAGGG
AATTGCATATGCTGTTATGGAATTAATAAAAAATAGCAAATTAAGAGAAATTTTAGCTAAAAGAGGTAGACAAACTGCTT
TGAATTTTGATTTTGAAAAAATTACAGAAATGTGGGAAACGGTGCTTTATAAAGTGAAAGGGGATGCTTAG

Upstream 100 bases:

>100_bases
TCAGCAACCGCAGACAGTACTGCAATTGCTCAGATAAATGTAAGGGAGGCGATGCCTCCCTTAAAATTTATTAAGTGTGG
AATTACAGGAGGAAATTTTT

Downstream 100 bases:

>100_bases
TATGGATCTGAAAGACCAATTCAAAATGTTGTATAAAGAAATTTCTCCTTCAACCCTTTCCCTTTGCCTTATCACAAAAA
ATGAAGAAAAAAATATATCT

Product: glycosyltransferase

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 556; Mature: 555

Protein sequence:

>556_residues
MPTSWYNVIPEILSLIEKHKPRSILDVGIGFGKYGVLIREVLELPYERYDKLKWQHRVEGVEVFEGYKNPLHTYAYDKVY
YSNILDVIDKLPQYDVILLIDVLEHFTKEEGYLLLDKLLEHTKNFILISTPLYPDIQKDYEGNPHEEHKSRWSIIDFVDY
DYSFKLIPIGNNGAQLFTIFPTAQGVKEKINTHLYTQIIENNSLNAKPKLKIGYLLPHKNLTGGLKMLLENMRYMKKRGH
TICGFLKSDTNDDVIPNWYRDIEIDEKIILPHKDSFSYYIEDCDIVIAGWLGQLIELKRNKIHVIYWEQGSEWLFGDYRD
LSPNSKIREHLKECFSSDVTFVSASPLIAKVLKVRYGKDSTIIPNGIDTTFYFPRKKEKSSQDISILLVGHPYLWFKGFE
VALIALEMVWRKGYRFNVNWVCQELPNVKNLSYPINFIKKPSQEELAEIYRNSDMLVFTSWYEGFGMPPLEAMASGIPVI
STRCGGVESFITPGVNGILVEPGDIEGIAYAVMELIKNSKLREILAKRGRQTALNFDFEKITEMWETVLYKVKGDA

Sequences:

>Translated_556_residues
MPTSWYNVIPEILSLIEKHKPRSILDVGIGFGKYGVLIREVLELPYERYDKLKWQHRVEGVEVFEGYKNPLHTYAYDKVY
YSNILDVIDKLPQYDVILLIDVLEHFTKEEGYLLLDKLLEHTKNFILISTPLYPDIQKDYEGNPHEEHKSRWSIIDFVDY
DYSFKLIPIGNNGAQLFTIFPTAQGVKEKINTHLYTQIIENNSLNAKPKLKIGYLLPHKNLTGGLKMLLENMRYMKKRGH
TICGFLKSDTNDDVIPNWYRDIEIDEKIILPHKDSFSYYIEDCDIVIAGWLGQLIELKRNKIHVIYWEQGSEWLFGDYRD
LSPNSKIREHLKECFSSDVTFVSASPLIAKVLKVRYGKDSTIIPNGIDTTFYFPRKKEKSSQDISILLVGHPYLWFKGFE
VALIALEMVWRKGYRFNVNWVCQELPNVKNLSYPINFIKKPSQEELAEIYRNSDMLVFTSWYEGFGMPPLEAMASGIPVI
STRCGGVESFITPGVNGILVEPGDIEGIAYAVMELIKNSKLREILAKRGRQTALNFDFEKITEMWETVLYKVKGDA
>Mature_555_residues
PTSWYNVIPEILSLIEKHKPRSILDVGIGFGKYGVLIREVLELPYERYDKLKWQHRVEGVEVFEGYKNPLHTYAYDKVYY
SNILDVIDKLPQYDVILLIDVLEHFTKEEGYLLLDKLLEHTKNFILISTPLYPDIQKDYEGNPHEEHKSRWSIIDFVDYD
YSFKLIPIGNNGAQLFTIFPTAQGVKEKINTHLYTQIIENNSLNAKPKLKIGYLLPHKNLTGGLKMLLENMRYMKKRGHT
ICGFLKSDTNDDVIPNWYRDIEIDEKIILPHKDSFSYYIEDCDIVIAGWLGQLIELKRNKIHVIYWEQGSEWLFGDYRDL
SPNSKIREHLKECFSSDVTFVSASPLIAKVLKVRYGKDSTIIPNGIDTTFYFPRKKEKSSQDISILLVGHPYLWFKGFEV
ALIALEMVWRKGYRFNVNWVCQELPNVKNLSYPINFIKKPSQEELAEIYRNSDMLVFTSWYEGFGMPPLEAMASGIPVIS
TRCGGVESFITPGVNGILVEPGDIEGIAYAVMELIKNSKLREILAKRGRQTALNFDFEKITEMWETVLYKVKGDA

Specific function: Adds A Galactose Goup To A Glucose Group Of Lps. [C]

COG id: COG0438

COG function: function code M; Glycosyltransferase

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the glycosyltransferase 1 family [H]

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR001296 [H]

Pfam domain/function: PF00534 Glycos_transf_1 [H]

EC number: 2.4.1.- [C]

Molecular weight: Translated: 64477; Mature: 64346

Theoretical pI: Translated: 6.52; Mature: 6.52

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.9 %Cys     (Translated Protein)
1.8 %Met     (Translated Protein)
2.7 %Cys+Met (Translated Protein)
0.9 %Cys     (Mature Protein)
1.6 %Met     (Mature Protein)
2.5 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MPTSWYNVIPEILSLIEKHKPRSILDVGIGFGKYGVLIREVLELPYERYDKLKWQHRVEG
CCCHHHHHHHHHHHHHHHCCCCCEEHHCCCCCHHHHHHHHHHHCCHHHHHHHHHHHHCCH
VEVFEGYKNPLHTYAYDKVYYSNILDVIDKLPQYDVILLIDVLEHFTKEEGYLLLDKLLE
HHHHHHCCCCHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHCCCCCEEHHHHHHH
HTKNFILISTPLYPDIQKDYEGNPHEEHKSRWSIIDFVDYDYSFKLIPIGNNGAQLFTIF
HCCCEEEEECCCCCCCHHCCCCCCCHHHHCCCCEEEEECCCCEEEEEEECCCCCEEEEEE
PTAQGVKEKINTHLYTQIIENNSLNAKPKLKIGYLLPHKNLTGGLKMLLENMRYMKKRGH
CCCHHHHHHHHHHHHHHHHCCCCCCCCCCEEEEEEECCCCCHHHHHHHHHHHHHHHHCCC
TICGFLKSDTNDDVIPNWYRDIEIDEKIILPHKDSFSYYIEDCDIVIAGWLGQLIELKRN
EEEEEEECCCCCCCCCCCCCCCCCCCEEECCCCCCCEEEEECCCEEHHHHHHHHHHHCCC
KIHVIYWEQGSEWLFGDYRDLSPNSKIREHLKECFSSDVTFVSASPLIAKVLKVRYGKDS
CEEEEEEECCCCEEECCCCCCCCCHHHHHHHHHHHCCCCEEEECCHHHHHHHHHHCCCCC
TIIPNGIDTTFYFPRKKEKSSQDISILLVGHPYLWFKGFEVALIALEMVWRKGYRFNVNW
CCCCCCCCCCEECCCCCCCCCCCEEEEEEECCEEECCCHHHHHHHHHHHHHCCCEEEEEH
VCQELPNVKNLSYPINFIKKPSQEELAEIYRNSDMLVFTSWYEGFGMPPLEAMASGIPVI
HHHHCCCCCCCCCCHHHHCCCCHHHHHHHHCCCCEEEEEECCCCCCCCCHHHHHCCCCEE
STRCGGVESFITPGVNGILVEPGDIEGIAYAVMELIKNSKLREILAKRGRQTALNFDFEK
EECCCCHHHHHCCCCCEEEECCCCCCHHHHHHHHHHHCCHHHHHHHHCCCCEEECCCHHH
ITEMWETVLYKVKGDA
HHHHHHHHHHHCCCCC
>Mature Secondary Structure 
PTSWYNVIPEILSLIEKHKPRSILDVGIGFGKYGVLIREVLELPYERYDKLKWQHRVEG
CCHHHHHHHHHHHHHHHCCCCCEEHHCCCCCHHHHHHHHHHHCCHHHHHHHHHHHHCCH
VEVFEGYKNPLHTYAYDKVYYSNILDVIDKLPQYDVILLIDVLEHFTKEEGYLLLDKLLE
HHHHHHCCCCHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHCCCCCEEHHHHHHH
HTKNFILISTPLYPDIQKDYEGNPHEEHKSRWSIIDFVDYDYSFKLIPIGNNGAQLFTIF
HCCCEEEEECCCCCCCHHCCCCCCCHHHHCCCCEEEEECCCCEEEEEEECCCCCEEEEEE
PTAQGVKEKINTHLYTQIIENNSLNAKPKLKIGYLLPHKNLTGGLKMLLENMRYMKKRGH
CCCHHHHHHHHHHHHHHHHCCCCCCCCCCEEEEEEECCCCCHHHHHHHHHHHHHHHHCCC
TICGFLKSDTNDDVIPNWYRDIEIDEKIILPHKDSFSYYIEDCDIVIAGWLGQLIELKRN
EEEEEEECCCCCCCCCCCCCCCCCCCEEECCCCCCCEEEEECCCEEHHHHHHHHHHHCCC
KIHVIYWEQGSEWLFGDYRDLSPNSKIREHLKECFSSDVTFVSASPLIAKVLKVRYGKDS
CEEEEEEECCCCEEECCCCCCCCCHHHHHHHHHHHCCCCEEEECCHHHHHHHHHHCCCCC
TIIPNGIDTTFYFPRKKEKSSQDISILLVGHPYLWFKGFEVALIALEMVWRKGYRFNVNW
CCCCCCCCCCEECCCCCCCCCCCEEEEEEECCEEECCCHHHHHHHHHHHHHCCCEEEEEH
VCQELPNVKNLSYPINFIKKPSQEELAEIYRNSDMLVFTSWYEGFGMPPLEAMASGIPVI
HHHHCCCCCCCCCCHHHHCCCCHHHHHHHHCCCCEEEEEECCCCCCCCCHHHHHCCCCEE
STRCGGVESFITPGVNGILVEPGDIEGIAYAVMELIKNSKLREILAKRGRQTALNFDFEK
EECCCCHHHHHCCCCCEEEECCCCCCHHHHHHHHHHHCCHHHHHHHHCCCCEEECCCHHH
ITEMWETVLYKVKGDA
HHHHHHHHHHHCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: Glycosyltransferases; Hexosyltransferases [C]

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 8688087 [H]