Definition Mycobacterium bovis BCG str. Pasteur 1173P2, complete genome.
Accession NC_008769
Length 4,374,522

Click here to switch to the map view.

The map label for this gene is tkt

Identifier: 121637379

GI number: 121637379

Start: 1652909

End: 1655011

Strand: Reverse

Name: tkt

Synonym: BCG_1510c

Alternate gene names: 121637379

Gene position: 1655011-1652909 (Counterclockwise)

Preceding gene: 121637380

Following gene: 121637378

Centisome position: 37.83

GC content: 67.81

Gene sequence:

>2103_bases
GTGACCACACTCGAAGAGATCTCCGCGCTTACCCGACCGCGCCATCCCGACGACTGGACCGAGATCGATTCGGCTGCCGT
CGACACCATCCGGGTATTGGCCGCCGATGCCGTCCAAAAGGTCGGCAACGGTCATCCTGGAACGGCGATGAGCCTGGCTC
CGTTGGCCTACACGCTGTTTCAGCGGACAATGCGTCACGATCCCAGCGACACACACTGGCTGGGCCGCGATCGGTTCGTT
TTGTCGGCCGGGCACAGCAGCCTGACCCTCTACATCCAGCTCTACCTCGGCGGCTTCGGCCTGGAACTGTCCGACATTGA
GTCGTTGCGCACCTGGGGATCCAAGACCCCCGGACACCCGGAGTTCCGCCACACCCCCGGCGTTGAGATCACCACCGGCC
CGCTGGGGCAGGGACTGGCGTCGGCGGTCGGGATGGCGATGGCCTCGCGCTACGAGCGCGGCCTGTTCGACCCGGACGCC
GAACCGGGCGCCAGCCCCTTCGACCACTACATCTATGTCATCGCCTCCGACGGTGACATCGAAGAAGGGGTGACCTCGGA
GGCGTCGTCGCTGGCCGCGGTCCAGCAACTGGGCAACCTCATCGTGTTCTACGACCGCAACCAGATCTCGATCGAGGACG
ACACCAACATCGCGCTGTGTGAGGACACCGCGGCCCGCTACCGCGCGTACGGCTGGCACGTGCAAGAGGTTGAGGGCGGT
GAGAACGTCGTCGGCATCGAGGAGGCCATCGCCAATGCGCAGGCGGTCACCGACCGGCCCTCGTTCATCGCGCTGCGCAC
CGTCATCGGCTATCCGGCGCCGAACCTGATGGACACCGGCAAGGCGCACGGCGCGGCGCTGGGCGACGACGAGGTGGCCG
CAGTCAAGAAGATCGTCGGCTTCGATCCGGACAAGACGTTCCAGGTCCGCGAGGACGTCCTCACCCACACCCGAGGGCTG
GTGGCCCGCGGCAAACAGGCCCACGAACGCTGGCAGCTCGAATTCGATGCCTGGGCGCGGCGTGAACCCGAGCGCAAGGC
GCTGCTGGACCGGCTGCTCGCGCAGAAGTTGCCCGACGGCTGGGACGCCGACTTGCCCCACTGGGAACCGGGGTCCAAGG
CGCTGGCCACCCGTGCGGCCTCGGGTGCGGTGCTGTCCGCGCTCGGGCCGAAACTGCCCGAGTTGTGGGGCGGTTCGGCC
GACCTGGCGGGCAGCAACAACACAACGATAAAGGGCGCCGACTCCTTTGGCCCGCCCTCGATTTCCACCAAGGAGTACAC
CGCGCACTGGTATGGTCGCACCTTGCACTTCGGTGTTCGCGAGCACGCGATGGGTGCCATCCTGTCCGGCATCGTGCTGC
ACGGACCCACCCGGGCTTACGGCGGCACCTTCCTGCAGTTCTCCGACTACATGCGCCCGGCGGTGCGGCTGGCGGCGTTG
ATGGACATCGACACCATCTACGTCTGGACGCACGACTCGATCGGCCTCGGCGAAGACGGGCCCACCCATCAACCGATCGA
GCACCTCTCGGCGCTGCGCGCGATCCCCCGGCTGTCGGTGGTGCGCCCGGCAGATGCCAACGAGACAGCCTACGCCTGGC
GCACGATCCTGGCCCGCCGCAACGGCAGCGGGCCGGTCGGGTTGATCCTGACCCGCCAGGGTGTGCCGGTGCTGGACGGC
ACCGACGCCGAGGGGGTTGCCCGCGGCGGTTACGTGCTGAGTGACGCCGGTGGTCTGCAACCGGGCGAGGAACCCGACGT
CATTCTCATCGCCACCGGCTCGGAGGTGCAGCTGGCGGTCGCGGCGCAGACGTTGCTGGCGGACAACGACATCCTCGCTC
GGGTGGTGTCGATGCCGTGCCTGGAGTGGTTCGAGGCCCAACCCTACGAGTACCGCGACGCGGTGCTGCCCCCGACGGTG
TCGGCGCGGGTGGCCGTCGAAGCCGGCGTCGCGCAATGCTGGCACCAGCTGGTTGGCGACACGGGCGAGATCGTCTCGAT
CGAGCACTACGGCGAATCCGCGGACCACAAGACCTTGTTCCGCGAGTACGGCTTCACTGCCGAGGCCGTGGCCGCCGCCG
CCGAACGAGCGCTGGATAACTGA

Upstream 100 bases:

>100_bases
ACAGGGCCCGGATGGGTACCCGGATATGCGGCACTGCAAGCGCCGGGATTCCCGCACTAGGGTGAGGACTGATCATCTTG
CTGACTCGAGGACTGAATTT

Downstream 100 bases:

>100_bases
GGAAGGGTGATTACCGATGACCGCTCAGAACCCCAACCTGGCCGCATTGAGCGCCGCGGGGGTATCGGTGTGGCTGGATG
ACCTGTCGCGGGACCGGCTG

Product: transketolase

Products: NA

Alternate protein names: TK

Number of amino acids: Translated: 700; Mature: 699

Protein sequence:

>700_residues
MTTLEEISALTRPRHPDDWTEIDSAAVDTIRVLAADAVQKVGNGHPGTAMSLAPLAYTLFQRTMRHDPSDTHWLGRDRFV
LSAGHSSLTLYIQLYLGGFGLELSDIESLRTWGSKTPGHPEFRHTPGVEITTGPLGQGLASAVGMAMASRYERGLFDPDA
EPGASPFDHYIYVIASDGDIEEGVTSEASSLAAVQQLGNLIVFYDRNQISIEDDTNIALCEDTAARYRAYGWHVQEVEGG
ENVVGIEEAIANAQAVTDRPSFIALRTVIGYPAPNLMDTGKAHGAALGDDEVAAVKKIVGFDPDKTFQVREDVLTHTRGL
VARGKQAHERWQLEFDAWARREPERKALLDRLLAQKLPDGWDADLPHWEPGSKALATRAASGAVLSALGPKLPELWGGSA
DLAGSNNTTIKGADSFGPPSISTKEYTAHWYGRTLHFGVREHAMGAILSGIVLHGPTRAYGGTFLQFSDYMRPAVRLAAL
MDIDTIYVWTHDSIGLGEDGPTHQPIEHLSALRAIPRLSVVRPADANETAYAWRTILARRNGSGPVGLILTRQGVPVLDG
TDAEGVARGGYVLSDAGGLQPGEEPDVILIATGSEVQLAVAAQTLLADNDILARVVSMPCLEWFEAQPYEYRDAVLPPTV
SARVAVEAGVAQCWHQLVGDTGEIVSIEHYGESADHKTLFREYGFTAEAVAAAAERALDN

Sequences:

>Translated_700_residues
MTTLEEISALTRPRHPDDWTEIDSAAVDTIRVLAADAVQKVGNGHPGTAMSLAPLAYTLFQRTMRHDPSDTHWLGRDRFV
LSAGHSSLTLYIQLYLGGFGLELSDIESLRTWGSKTPGHPEFRHTPGVEITTGPLGQGLASAVGMAMASRYERGLFDPDA
EPGASPFDHYIYVIASDGDIEEGVTSEASSLAAVQQLGNLIVFYDRNQISIEDDTNIALCEDTAARYRAYGWHVQEVEGG
ENVVGIEEAIANAQAVTDRPSFIALRTVIGYPAPNLMDTGKAHGAALGDDEVAAVKKIVGFDPDKTFQVREDVLTHTRGL
VARGKQAHERWQLEFDAWARREPERKALLDRLLAQKLPDGWDADLPHWEPGSKALATRAASGAVLSALGPKLPELWGGSA
DLAGSNNTTIKGADSFGPPSISTKEYTAHWYGRTLHFGVREHAMGAILSGIVLHGPTRAYGGTFLQFSDYMRPAVRLAAL
MDIDTIYVWTHDSIGLGEDGPTHQPIEHLSALRAIPRLSVVRPADANETAYAWRTILARRNGSGPVGLILTRQGVPVLDG
TDAEGVARGGYVLSDAGGLQPGEEPDVILIATGSEVQLAVAAQTLLADNDILARVVSMPCLEWFEAQPYEYRDAVLPPTV
SARVAVEAGVAQCWHQLVGDTGEIVSIEHYGESADHKTLFREYGFTAEAVAAAAERALDN
>Mature_699_residues
TTLEEISALTRPRHPDDWTEIDSAAVDTIRVLAADAVQKVGNGHPGTAMSLAPLAYTLFQRTMRHDPSDTHWLGRDRFVL
SAGHSSLTLYIQLYLGGFGLELSDIESLRTWGSKTPGHPEFRHTPGVEITTGPLGQGLASAVGMAMASRYERGLFDPDAE
PGASPFDHYIYVIASDGDIEEGVTSEASSLAAVQQLGNLIVFYDRNQISIEDDTNIALCEDTAARYRAYGWHVQEVEGGE
NVVGIEEAIANAQAVTDRPSFIALRTVIGYPAPNLMDTGKAHGAALGDDEVAAVKKIVGFDPDKTFQVREDVLTHTRGLV
ARGKQAHERWQLEFDAWARREPERKALLDRLLAQKLPDGWDADLPHWEPGSKALATRAASGAVLSALGPKLPELWGGSAD
LAGSNNTTIKGADSFGPPSISTKEYTAHWYGRTLHFGVREHAMGAILSGIVLHGPTRAYGGTFLQFSDYMRPAVRLAALM
DIDTIYVWTHDSIGLGEDGPTHQPIEHLSALRAIPRLSVVRPADANETAYAWRTILARRNGSGPVGLILTRQGVPVLDGT
DAEGVARGGYVLSDAGGLQPGEEPDVILIATGSEVQLAVAAQTLLADNDILARVVSMPCLEWFEAQPYEYRDAVLPPTVS
ARVAVEAGVAQCWHQLVGDTGEIVSIEHYGESADHKTLFREYGFTAEAVAAAAERALDN

Specific function: Unknown

COG id: COG0021

COG function: function code G; Transketolase

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the transketolase family

Homologues:

Organism=Homo sapiens, GI205277463, Length=650, Percent_Identity=24.9230769230769, Blast_Score=140, Evalue=3e-33,
Organism=Homo sapiens, GI4507521, Length=650, Percent_Identity=24.9230769230769, Blast_Score=140, Evalue=3e-33,
Organism=Homo sapiens, GI133778974, Length=597, Percent_Identity=24.4556113902848, Blast_Score=119, Evalue=9e-27,
Organism=Homo sapiens, GI225637459, Length=591, Percent_Identity=21.9966159052453, Blast_Score=103, Evalue=4e-22,
Organism=Homo sapiens, GI225637463, Length=493, Percent_Identity=22.920892494929, Blast_Score=98, Evalue=3e-20,
Organism=Homo sapiens, GI225637461, Length=493, Percent_Identity=22.920892494929, Blast_Score=98, Evalue=3e-20,
Organism=Escherichia coli, GI1788808, Length=677, Percent_Identity=44.903988183161, Blast_Score=539, Evalue=1e-154,
Organism=Escherichia coli, GI48994911, Length=677, Percent_Identity=42.9837518463811, Blast_Score=526, Evalue=1e-150,
Organism=Caenorhabditis elegans, GI17539652, Length=602, Percent_Identity=24.7508305647841, Blast_Score=134, Evalue=2e-31,
Organism=Saccharomyces cerevisiae, GI6325331, Length=687, Percent_Identity=44.6870451237263, Blast_Score=547, Evalue=1e-156,
Organism=Saccharomyces cerevisiae, GI6319593, Length=688, Percent_Identity=43.3139534883721, Blast_Score=526, Evalue=1e-150,
Organism=Drosophila melanogaster, GI45551847, Length=589, Percent_Identity=24.7877758913413, Blast_Score=139, Evalue=9e-33,
Organism=Drosophila melanogaster, GI45550715, Length=589, Percent_Identity=24.7877758913413, Blast_Score=139, Evalue=9e-33,
Organism=Drosophila melanogaster, GI24645119, Length=569, Percent_Identity=24.6045694200351, Blast_Score=124, Evalue=3e-28,
Organism=Drosophila melanogaster, GI24666278, Length=588, Percent_Identity=23.2993197278912, Blast_Score=116, Evalue=7e-26,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): TKT_MYCBO (P59956)

Other databases:

- EMBL:   BX248339
- RefSeq:   NP_855136.1
- ProteinModelPortal:   P59956
- SMR:   P59956
- EnsemblBacteria:   EBMYCT00000015203
- GeneID:   1092341
- GenomeReviews:   BX248333_GR
- KEGG:   mbo:Mb1484c
- GeneTree:   EBGT00050000016270
- HOGENOM:   HBG565885
- OMA:   ISIEHYG
- ProtClustDB:   PRK05899
- BioCyc:   MBOV233413:MB1484C-MONOMER
- BRENDA:   2.2.1.1
- InterPro:   IPR009014
- InterPro:   IPR015941
- InterPro:   IPR005475
- InterPro:   IPR005478
- InterPro:   IPR020826
- InterPro:   IPR005476
- InterPro:   IPR005474
- Gene3D:   G3DSA:3.40.50.920
- PANTHER:   PTHR11624:SF1
- SMART:   SM00861
- TIGRFAMs:   TIGR00232

Pfam domain/function: PF02779 Transket_pyr; PF02780 Transketolase_C; PF00456 Transketolase_N; SSF52922 Transketo_C_like

EC number: =2.2.1.1

Molecular weight: Translated: 75541; Mature: 75410

Theoretical pI: Translated: 4.75; Mature: 4.75

Prosite motif: PS00801 TRANSKETOLASE_1; PS00802 TRANSKETOLASE_2

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.4 %Cys     (Translated Protein)
1.4 %Met     (Translated Protein)
1.9 %Cys+Met (Translated Protein)
0.4 %Cys     (Mature Protein)
1.3 %Met     (Mature Protein)
1.7 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MTTLEEISALTRPRHPDDWTEIDSAAVDTIRVLAADAVQKVGNGHPGTAMSLAPLAYTLF
CCCHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHH
QRTMRHDPSDTHWLGRDRFVLSAGHSSLTLYIQLYLGGFGLELSDIESLRTWGSKTPGHP
HHHHCCCCCCCCCCCCCCEEEECCCCCEEEEEEEEECCCCCCHHHHHHHHHCCCCCCCCC
EFRHTPGVEITTGPLGQGLASAVGMAMASRYERGLFDPDAEPGASPFDHYIYVIASDGDI
CCCCCCCCEEECCCCCHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCEEEEEECCCCC
EEGVTSEASSLAAVQQLGNLIVFYDRNQISIEDDTNIALCEDTAARYRAYGWHVQEVEGG
CCCCHHHHHHHHHHHHHCCEEEEEECCEEEECCCCCEEEECCHHHHHHHCCCEEEEECCC
ENVVGIEEAIANAQAVTDRPSFIALRTVIGYPAPNLMDTGKAHGAALGDDEVAAVKKIVG
CCEEEHHHHHHCCHHHCCCCCCEEEHHHHCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHC
FDPDKTFQVREDVLTHTRGLVARGKQAHERWQLEFDAWARREPERKALLDRLLAQKLPDG
CCCCCCHHHHHHHHHHHHHHHHCCHHHHHHEEEEEHHHHCCCCHHHHHHHHHHHHHCCCC
WDADLPHWEPGSKALATRAASGAVLSALGPKLPELWGGSADLAGSNNTTIKGADSFGPPS
CCCCCCCCCCCCHHHHHHHCCCHHHHHHCCCCHHHCCCCCCCCCCCCCEEECCCCCCCCC
ISTKEYTAHWYGRTLHFGVREHAMGAILSGIVLHGPTRAYGGTFLQFSDYMRPAVRLAAL
CCCCCHHHHHCCCEEECCHHHHHHHHHHHHHHCCCCCHHCCCEEEEHHHHHHHHHHHHHH
MDIDTIYVWTHDSIGLGEDGPTHQPIEHLSALRAIPRLSVVRPADANETAYAWRTILARR
HCCCEEEEEECCCCCCCCCCCCCCHHHHHHHHHHCCCCEEECCCCCCCHHHHHHHHHHHC
NGSGPVGLILTRQGVPVLDGTDAEGVARGGYVLSDAGGLQPGEEPDVILIATGSEVQLAV
CCCCCEEEEEECCCCCEECCCCCCCCCCCCEEEECCCCCCCCCCCCEEEEECCCCEEEEE
AAQTLLADNDILARVVSMPCLEWFEAQPYEYRDAVLPPTVSARVAVEAGVAQCWHQLVGD
HHHHHHCCCHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHCC
TGEIVSIEHYGESADHKTLFREYGFTAEAVAAAAERALDN
CCCEEEEEECCCCCHHHHHHHHHCCCHHHHHHHHHHHCCC
>Mature Secondary Structure 
TTLEEISALTRPRHPDDWTEIDSAAVDTIRVLAADAVQKVGNGHPGTAMSLAPLAYTLF
CCHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHH
QRTMRHDPSDTHWLGRDRFVLSAGHSSLTLYIQLYLGGFGLELSDIESLRTWGSKTPGHP
HHHHCCCCCCCCCCCCCCEEEECCCCCEEEEEEEEECCCCCCHHHHHHHHHCCCCCCCCC
EFRHTPGVEITTGPLGQGLASAVGMAMASRYERGLFDPDAEPGASPFDHYIYVIASDGDI
CCCCCCCCEEECCCCCHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCEEEEEECCCCC
EEGVTSEASSLAAVQQLGNLIVFYDRNQISIEDDTNIALCEDTAARYRAYGWHVQEVEGG
CCCCHHHHHHHHHHHHHCCEEEEEECCEEEECCCCCEEEECCHHHHHHHCCCEEEEECCC
ENVVGIEEAIANAQAVTDRPSFIALRTVIGYPAPNLMDTGKAHGAALGDDEVAAVKKIVG
CCEEEHHHHHHCCHHHCCCCCCEEEHHHHCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHC
FDPDKTFQVREDVLTHTRGLVARGKQAHERWQLEFDAWARREPERKALLDRLLAQKLPDG
CCCCCCHHHHHHHHHHHHHHHHCCHHHHHHEEEEEHHHHCCCCHHHHHHHHHHHHHCCCC
WDADLPHWEPGSKALATRAASGAVLSALGPKLPELWGGSADLAGSNNTTIKGADSFGPPS
CCCCCCCCCCCCHHHHHHHCCCHHHHHHCCCCHHHCCCCCCCCCCCCCEEECCCCCCCCC
ISTKEYTAHWYGRTLHFGVREHAMGAILSGIVLHGPTRAYGGTFLQFSDYMRPAVRLAAL
CCCCCHHHHHCCCEEECCHHHHHHHHHHHHHHCCCCCHHCCCEEEEHHHHHHHHHHHHHH
MDIDTIYVWTHDSIGLGEDGPTHQPIEHLSALRAIPRLSVVRPADANETAYAWRTILARR
HCCCEEEEEECCCCCCCCCCCCCCHHHHHHHHHHCCCCEEECCCCCCCHHHHHHHHHHHC
NGSGPVGLILTRQGVPVLDGTDAEGVARGGYVLSDAGGLQPGEEPDVILIATGSEVQLAV
CCCCCEEEEEECCCCCEECCCCCCCCCCCCEEEECCCCCCCCCCCCEEEEECCCCEEEEE
AAQTLLADNDILARVVSMPCLEWFEAQPYEYRDAVLPPTVSARVAVEAGVAQCWHQLVGD
HHHHHHCCCHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHCC
TGEIVSIEHYGESADHKTLFREYGFTAEAVAAAAERALDN
CCCEEEEEECCCCCHHHHHHHHHCCCHHHHHHHHHHHCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 12788972