Definition Rhizobium leguminosarum bv. trifolii WSM2304 chromosome, complete genome.
Accession NC_011369
Length 4,537,948

Click here to switch to the map view.

The map label for this gene is cbbT [H]

Identifier: 209550812

GI number: 209550812

Start: 3324359

End: 3326332

Strand: Direct

Name: cbbT [H]

Synonym: Rleg2_3236

Alternate gene names: 209550812

Gene position: 3324359-3326332 (Clockwise)

Preceding gene: 209550809

Following gene: 209550813

Centisome position: 73.26

GC content: 62.66

Gene sequence:

>1974_bases
ATGACCTCTCCCGAACAACATGACCGGATGGCGAATGCGATCCGTTTTCTCGCCATGGACGCCGTCGAAAAGGCGAACTC
CGGCCACCCGGGCATGCCGATGGGCATGGCCGATGTGGCAACGGTCCTGTTCACCAAATATCTGAAGTTCGATCCGAAGA
AGCCGCATTGGCCGAACCGCGATCGCTTCGTGCTCTCGGCCGGCCATGGCTCGATGCTGCTTTATTCGCTGCTGTATTTG
ACCGGCTATCCCGACATGACGGTCGAGGATCTAAAGCAGTTCCGCCAGCTCGGCTCGAAGACCGCCGGCCATCCTGAATA
TGGTCACGCCACCGGCATCGAAACGACCACCGGCCCGCTCGGCCAGGGCATTGCCAATTCCGTCGGCATGGCGATTGCCG
AACGCAAGCTGCGCGAGGAGTTCGGCGCCGATCTTCAGGATCACTTTACCTATGCGATCTGCGGCGACGGCTGCCTGATG
GAGGGTATCAGCCACGAAGCCATAGCGCTCGCCGGCCACCTGAAGCTCAACAAGCTCGTTCTGTTCTGGGATAACAACTC
GATCACCATCGACGGCGCCGTATCTCTGTCGGATTCCACCGATCAGATCGCCCGCTTCAAGGCCGTTCACTGGAACACGA
TCGAGATCGACGGTCACGACCAGGCTGCCATCGCCGCCGCGATCGACGCTGCCCACAAGTCCGACCGGCCGACCTTCATT
GCCTGCAAGACGATCATCGGCTTCGGCGCCCCCAACAAGCAGGGCACCCATAAGGTTCACGGCAACCCGCTCGGCGCCGA
AGAAATCGCCGCCACCCGCAAGGCGCTGAACTGGGAATCCGAACCCTTCGTCATCCCGTCGGACGTCCTGGACAGCTGGC
GTGCAGCCGGCGCCCGCTCCGTCGATCTCGTCAACGCCTGGGAACAGGGTCTGGCCAAGGCTCCGGCCAAGGCCGAATTC
ACCCGCCGTATGGCAGGCGAGTTGCCGGAAGGCTTCGATGCCGCGATCAGCGCTTACAAGAAGAAGCTTGCCGAGACCAA
GCCGACGGTTGCCACCCGCAAGGCTTCGGAAGACGCGCTCGAGGTCATCAACGGCTTCCTGCCGGAAACGCTCGGCGGCT
CCGCCGACCTGACGCCGTCGAACAACACCAAGACCAGCCAGATGCATTCGATCACGCCGACGGATTTCGCCGGCCGGTAC
ATGCATTGGGGCATCCGCGAGCACGGCATGGCTTCTGCCATGAACGGCATTGCGCTGCATGGCGGCCTCATTCCCTATAG
CGGCGGCTTCCTGATCTTCTCGGATTATTGCCGCCCGCCGATCCGCCTCGCTGCGCTGATGGGCATCCGCGTCATTCACG
TCCTGACGCATGACTCGATCGGCGTCGGCGAAGATGGTCCGACGCACCAGCCGGTCGAACAGCTCGCCGGTCTGCGCGCC
ATCCCGAACCTGATGGTCTTCCGTCCGGCCGACGCCACGGAAACGGCGGAATGCTGGCAGATCGCCGTCAAGACGCACAA
CCGTCCTTCCGGCCTTGCGCTGACACGCCAGAACCTCACCGCGTCCCGCACCGAATACAGCGAAAAGAACCTCTGCGAAC
AGGGCGCCTATACGCTGGCCGGCAATGCCGACGCCAAGGTGACGATCTTCGCCTCCGGCTCGGAAGTCGAAATCGCCGTT
GCCGCCCGCGCAGCCCTTGAAGCCAAGGGTGTCACGGTGCGCGTCGTATCGGTTCCCTGCACGGAACTGTTCTTCGAGCA
GCCGGACGCCTACCGCAAGGAAATCCTTGGCAACTCGCCGGTCAAGATCGCCGTCGAAGCCGCCGTCCGCGAAGGCTGGG
ATGCTTTCATCGGACCGGAAGGCACTTTCATCGGCATGAAGGGCTTCGGCGCTTCCGGCCCGGTGAAGGACGTTTACAAG
CATTTCGGCATCACTGCCGACGCCGTCGTTGCGGCCGCGGAAGCAAAGCTTTAA

Upstream 100 bases:

>100_bases
ATTGACTTGCCAGCGCCAACTGCTATGTGTCTGCCGCTTTCACTCGATGGTCTTGGAGGCTCGAGGCCATCCCCCGACAC
CCGGAACTTGCGGAAAAGCC

Downstream 100 bases:

>100_bases
TGAGGGCGCCTTGAGGCGCTCTCCATCTCCTCAATTCCAGGCCCTTTCTATCGGGCTCTATTCTATCGGGAGTGAATGAA
CATGACAGTCAAGGTTGCCA

Product: transketolase

Products: NA

Alternate protein names: TK [H]

Number of amino acids: Translated: 657; Mature: 656

Protein sequence:

>657_residues
MTSPEQHDRMANAIRFLAMDAVEKANSGHPGMPMGMADVATVLFTKYLKFDPKKPHWPNRDRFVLSAGHGSMLLYSLLYL
TGYPDMTVEDLKQFRQLGSKTAGHPEYGHATGIETTTGPLGQGIANSVGMAIAERKLREEFGADLQDHFTYAICGDGCLM
EGISHEAIALAGHLKLNKLVLFWDNNSITIDGAVSLSDSTDQIARFKAVHWNTIEIDGHDQAAIAAAIDAAHKSDRPTFI
ACKTIIGFGAPNKQGTHKVHGNPLGAEEIAATRKALNWESEPFVIPSDVLDSWRAAGARSVDLVNAWEQGLAKAPAKAEF
TRRMAGELPEGFDAAISAYKKKLAETKPTVATRKASEDALEVINGFLPETLGGSADLTPSNNTKTSQMHSITPTDFAGRY
MHWGIREHGMASAMNGIALHGGLIPYSGGFLIFSDYCRPPIRLAALMGIRVIHVLTHDSIGVGEDGPTHQPVEQLAGLRA
IPNLMVFRPADATETAECWQIAVKTHNRPSGLALTRQNLTASRTEYSEKNLCEQGAYTLAGNADAKVTIFASGSEVEIAV
AARAALEAKGVTVRVVSVPCTELFFEQPDAYRKEILGNSPVKIAVEAAVREGWDAFIGPEGTFIGMKGFGASGPVKDVYK
HFGITADAVVAAAEAKL

Sequences:

>Translated_657_residues
MTSPEQHDRMANAIRFLAMDAVEKANSGHPGMPMGMADVATVLFTKYLKFDPKKPHWPNRDRFVLSAGHGSMLLYSLLYL
TGYPDMTVEDLKQFRQLGSKTAGHPEYGHATGIETTTGPLGQGIANSVGMAIAERKLREEFGADLQDHFTYAICGDGCLM
EGISHEAIALAGHLKLNKLVLFWDNNSITIDGAVSLSDSTDQIARFKAVHWNTIEIDGHDQAAIAAAIDAAHKSDRPTFI
ACKTIIGFGAPNKQGTHKVHGNPLGAEEIAATRKALNWESEPFVIPSDVLDSWRAAGARSVDLVNAWEQGLAKAPAKAEF
TRRMAGELPEGFDAAISAYKKKLAETKPTVATRKASEDALEVINGFLPETLGGSADLTPSNNTKTSQMHSITPTDFAGRY
MHWGIREHGMASAMNGIALHGGLIPYSGGFLIFSDYCRPPIRLAALMGIRVIHVLTHDSIGVGEDGPTHQPVEQLAGLRA
IPNLMVFRPADATETAECWQIAVKTHNRPSGLALTRQNLTASRTEYSEKNLCEQGAYTLAGNADAKVTIFASGSEVEIAV
AARAALEAKGVTVRVVSVPCTELFFEQPDAYRKEILGNSPVKIAVEAAVREGWDAFIGPEGTFIGMKGFGASGPVKDVYK
HFGITADAVVAAAEAKL
>Mature_656_residues
TSPEQHDRMANAIRFLAMDAVEKANSGHPGMPMGMADVATVLFTKYLKFDPKKPHWPNRDRFVLSAGHGSMLLYSLLYLT
GYPDMTVEDLKQFRQLGSKTAGHPEYGHATGIETTTGPLGQGIANSVGMAIAERKLREEFGADLQDHFTYAICGDGCLME
GISHEAIALAGHLKLNKLVLFWDNNSITIDGAVSLSDSTDQIARFKAVHWNTIEIDGHDQAAIAAAIDAAHKSDRPTFIA
CKTIIGFGAPNKQGTHKVHGNPLGAEEIAATRKALNWESEPFVIPSDVLDSWRAAGARSVDLVNAWEQGLAKAPAKAEFT
RRMAGELPEGFDAAISAYKKKLAETKPTVATRKASEDALEVINGFLPETLGGSADLTPSNNTKTSQMHSITPTDFAGRYM
HWGIREHGMASAMNGIALHGGLIPYSGGFLIFSDYCRPPIRLAALMGIRVIHVLTHDSIGVGEDGPTHQPVEQLAGLRAI
PNLMVFRPADATETAECWQIAVKTHNRPSGLALTRQNLTASRTEYSEKNLCEQGAYTLAGNADAKVTIFASGSEVEIAVA
ARAALEAKGVTVRVVSVPCTELFFEQPDAYRKEILGNSPVKIAVEAAVREGWDAFIGPEGTFIGMKGFGASGPVKDVYKH
FGITADAVVAAAEAKL

Specific function: Unknown

COG id: COG0021

COG function: function code G; Transketolase

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the transketolase family [H]

Homologues:

Organism=Homo sapiens, GI205277463, Length=661, Percent_Identity=26.6263237518911, Blast_Score=175, Evalue=1e-43,
Organism=Homo sapiens, GI4507521, Length=661, Percent_Identity=26.6263237518911, Blast_Score=175, Evalue=1e-43,
Organism=Homo sapiens, GI133778974, Length=673, Percent_Identity=26.4487369985141, Blast_Score=164, Evalue=2e-40,
Organism=Homo sapiens, GI225637459, Length=572, Percent_Identity=23.0769230769231, Blast_Score=120, Evalue=5e-27,
Organism=Homo sapiens, GI225637461, Length=544, Percent_Identity=22.7941176470588, Blast_Score=107, Evalue=3e-23,
Organism=Homo sapiens, GI225637463, Length=541, Percent_Identity=22.9205175600739, Blast_Score=107, Evalue=4e-23,
Organism=Escherichia coli, GI48994911, Length=662, Percent_Identity=52.2658610271903, Blast_Score=655, Evalue=0.0,
Organism=Escherichia coli, GI1788808, Length=659, Percent_Identity=49.165402124431, Blast_Score=619, Evalue=1e-178,
Organism=Caenorhabditis elegans, GI17539652, Length=585, Percent_Identity=27.1794871794872, Blast_Score=157, Evalue=2e-38,
Organism=Saccharomyces cerevisiae, GI6325331, Length=677, Percent_Identity=43.4268833087149, Blast_Score=515, Evalue=1e-146,
Organism=Saccharomyces cerevisiae, GI6319593, Length=673, Percent_Identity=42.9420505200594, Blast_Score=502, Evalue=1e-143,
Organism=Drosophila melanogaster, GI45551847, Length=575, Percent_Identity=28.1739130434783, Blast_Score=181, Evalue=1e-45,
Organism=Drosophila melanogaster, GI45550715, Length=575, Percent_Identity=28.1739130434783, Blast_Score=181, Evalue=1e-45,
Organism=Drosophila melanogaster, GI24645119, Length=544, Percent_Identity=28.3088235294118, Blast_Score=164, Evalue=2e-40,
Organism=Drosophila melanogaster, GI24666278, Length=570, Percent_Identity=25.2631578947368, Blast_Score=156, Evalue=4e-38,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR009014
- InterPro:   IPR015941
- InterPro:   IPR005475
- InterPro:   IPR005478
- InterPro:   IPR020826
- InterPro:   IPR005476
- InterPro:   IPR005474 [H]

Pfam domain/function: PF02779 Transket_pyr; PF02780 Transketolase_C; PF00456 Transketolase_N [H]

EC number: =2.2.1.1 [H]

Molecular weight: Translated: 70614; Mature: 70483

Theoretical pI: Translated: 6.48; Mature: 6.48

Prosite motif: PS00801 TRANSKETOLASE_1 ; PS00802 TRANSKETOLASE_2

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.1 %Cys     (Translated Protein)
2.7 %Met     (Translated Protein)
3.8 %Cys+Met (Translated Protein)
1.1 %Cys     (Mature Protein)
2.6 %Met     (Mature Protein)
3.7 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MTSPEQHDRMANAIRFLAMDAVEKANSGHPGMPMGMADVATVLFTKYLKFDPKKPHWPNR
CCCCHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHCCCCCCCCCCC
DRFVLSAGHGSMLLYSLLYLTGYPDMTVEDLKQFRQLGSKTAGHPEYGHATGIETTTGPL
CEEEEECCCCHHHHHHHHHHCCCCCCCHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCC
GQGIANSVGMAIAERKLREEFGADLQDHFTYAICGDGCLMEGISHEAIALAGHLKLNKLV
CHHHHHHHHHHHHHHHHHHHHCCCHHHCEEEEEECCCHHHCCCCCCCEEEEEEEEEEEEE
LFWDNNSITIDGAVSLSDSTDQIARFKAVHWNTIEIDGHDQAAIAAAIDAAHKSDRPTFI
EEECCCEEEEEEEEEECCCHHHHHHHEEEECEEEEECCCCCHHHHHHHHHHHCCCCCCEE
ACKTIIGFGAPNKQGTHKVHGNPLGAEEIAATRKALNWESEPFVIPSDVLDSWRAAGARS
EEEHHHCCCCCCCCCCEEECCCCCCHHHHHHHHHHCCCCCCCEECCHHHHHHHHHCCCCC
VDLVNAWEQGLAKAPAKAEFTRRMAGELPEGFDAAISAYKKKLAETKPTVATRKASEDAL
CHHHHHHHHHHHCCCCHHHHHHHHHHCCCCCHHHHHHHHHHHHHHCCCCHHHCCCCHHHH
EVINGFLPETLGGSADLTPSNNTKTSQMHSITPTDFAGRYMHWGIREHGMASAMNGIALH
HHHHHHCCHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHCCCCHHCCHHHHHCCEEEE
GGLIPYSGGFLIFSDYCRPPIRLAALMGIRVIHVLTHDSIGVGEDGPTHQPVEQLAGLRA
CCCCCCCCCEEEECCCCCCHHHHHHHHHHHEEEEEECCCCCCCCCCCCCCHHHHHHHHHH
IPNLMVFRPADATETAECWQIAVKTHNRPSGLALTRQNLTASRTEYSEKNLCEQGAYTLA
CCCEEEECCCCCCCHHHHHHHHHHCCCCCCCEEEEECCCCHHHHHHHHHHHHHCCCEEEE
GNADAKVTIFASGSEVEIAVAARAALEAKGVTVRVVSVPCTELFFEQPDAYRKEILGNSP
CCCCEEEEEEECCCEEEEEEEHHHHHHCCCCEEEEEECCHHHHHHCCCHHHHHHHCCCCC
VKIAVEAAVREGWDAFIGPEGTFIGMKGFGASGPVKDVYKHFGITADAVVAAAEAKL
EEEEEEHHHHCCCCEEECCCCCEEEECCCCCCCCHHHHHHHHCCCHHHHHHHHHCCC
>Mature Secondary Structure 
TSPEQHDRMANAIRFLAMDAVEKANSGHPGMPMGMADVATVLFTKYLKFDPKKPHWPNR
CCCHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHCCCCCCCCCCC
DRFVLSAGHGSMLLYSLLYLTGYPDMTVEDLKQFRQLGSKTAGHPEYGHATGIETTTGPL
CEEEEECCCCHHHHHHHHHHCCCCCCCHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCC
GQGIANSVGMAIAERKLREEFGADLQDHFTYAICGDGCLMEGISHEAIALAGHLKLNKLV
CHHHHHHHHHHHHHHHHHHHHCCCHHHCEEEEEECCCHHHCCCCCCCEEEEEEEEEEEEE
LFWDNNSITIDGAVSLSDSTDQIARFKAVHWNTIEIDGHDQAAIAAAIDAAHKSDRPTFI
EEECCCEEEEEEEEEECCCHHHHHHHEEEECEEEEECCCCCHHHHHHHHHHHCCCCCCEE
ACKTIIGFGAPNKQGTHKVHGNPLGAEEIAATRKALNWESEPFVIPSDVLDSWRAAGARS
EEEHHHCCCCCCCCCCEEECCCCCCHHHHHHHHHHCCCCCCCEECCHHHHHHHHHCCCCC
VDLVNAWEQGLAKAPAKAEFTRRMAGELPEGFDAAISAYKKKLAETKPTVATRKASEDAL
CHHHHHHHHHHHCCCCHHHHHHHHHHCCCCCHHHHHHHHHHHHHHCCCCHHHCCCCHHHH
EVINGFLPETLGGSADLTPSNNTKTSQMHSITPTDFAGRYMHWGIREHGMASAMNGIALH
HHHHHHCCHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHCCCCHHCCHHHHHCCEEEE
GGLIPYSGGFLIFSDYCRPPIRLAALMGIRVIHVLTHDSIGVGEDGPTHQPVEQLAGLRA
CCCCCCCCCEEEECCCCCCHHHHHHHHHHHEEEEEECCCCCCCCCCCCCCHHHHHHHHHH
IPNLMVFRPADATETAECWQIAVKTHNRPSGLALTRQNLTASRTEYSEKNLCEQGAYTLA
CCCEEEECCCCCCCHHHHHHHHHHCCCCCCCEEEEECCCCHHHHHHHHHHHHHCCCEEEE
GNADAKVTIFASGSEVEIAVAARAALEAKGVTVRVVSVPCTELFFEQPDAYRKEILGNSP
CCCCEEEEEEECCCEEEEEEEHHHHHHCCCCEEEEEECCHHHHHHCCCHHHHHHHCCCCC
VKIAVEAAVREGWDAFIGPEGTFIGMKGFGASGPVKDVYKHFGITADAVVAAAEAKL
EEEEEEHHHHCCCCEEECCCCCEEEECCCCCCCCHHHHHHHHCCCHHHHHHHHHCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 7928974 [H]