Definition Mycobacterium tuberculosis H37Ra, complete genome.
Accession NC_009525
Length 4,419,977

Click here to switch to the map view.

The map label for this gene is tkt [H]

Identifier: 148661241

GI number: 148661241

Start: 1629407

End: 1631509

Strand: Reverse

Name: tkt [H]

Synonym: MRA_1458

Alternate gene names: 148661241

Gene position: 1631509-1629407 (Counterclockwise)

Preceding gene: 148661242

Following gene: 148661240

Centisome position: 36.91

GC content: 67.76

Gene sequence:

>2103_bases
GTGACCACACTCGAAGAGATCTCCGCGCTTACCCGACCGCGCCATCCCGACTACTGGACCGAGATCGATTCGGCTGCCGT
CGACACCATCCGGGTATTGGCCGCCGATGCCGTCCAAAAGGTCGGCAACGGTCATCCTGGAACGGCGATGAGCCTGGCTC
CGTTGGCCTACACGCTGTTTCAGCGGACAATGCGTCACGATCCCAGCGACACACACTGGCTGGGCCGCGATCGGTTCGTT
TTGTCGGCCGGGCACAGCAGCCTGACCCTCTACATCCAGCTCTACCTCGGCGGCTTCGGCCTGGAACTGTCCGACATTGA
GTCGTTGCGCACCTGGGGATCCAAGACCCCCGGACACCCGGAGTTCCGCCACACCCCCGGCGTTGAGATCACCACCGGCC
CGCTGGGGCAGGGACTGGCGTCGGCGGTCGGGATGGCGATGGCCTCGCGCTACGAGCGCGGCCTGTTCGACCCGGACGCC
GAACCGGGCGCCAGCCCCTTCGACCACTACATCTATGTCATCGCCTCCGACGGTGACATCGAAGAAGGGGTGACCTCGGA
GGCGTCGTCGCTGGCCGCGGTCCAGCAACTGGGCAACCTCATCGTGTTCTACGACCGCAACCAGATCTCGATCGAGGACG
ACACCAACATCGCGCTGTGTGAGGACACCGCGGCCCGCTACCGCGCGTACGGCTGGCACGTGCAAGAGGTTGAGGGCGGT
GAGAACGTCGTCGGCATCGAGGAGGCCATCGCCAATGCGCAGGCGGTCACCGACCGGCCCTCGTTCATCGCGCTGCGCAC
CGTCATCGGCTATCCGGCGCCGAACCTGATGGACACCGGCAAGGCGCACGGCGCGGCGCTGGGCGACGACGAGGTGGCCG
CAGTCAAGAAGATCGTCGGCTTCGATCCGGACAAGACGTTCCAGGTCCGCGAGGACGTCCTCACCCACACCCGAGGGCTG
GTGGCCCGCGGCAAACAGGCCCACGAACGCTGGCAGCTCGAATTCGATGCCTGGGCGCGGCGTGAACCCGAGCGCAAGGC
GCTGCTGGACCGGCTGCTCGCGCAGAAGTTGCCCGACGGCTGGGACGCCGACTTGCCCCACTGGGAACCGGGGTCCAAGG
CGCTGGCCACCCGTGCGGCCTCGGGTGCGGTGCTGTCCGCGCTCGGGCCGAAACTGCCCGAGTTGTGGGGCGGTTCGGCC
GACCTGGCGGGCAGCAACAACACAACGATAAAGGGCGCCGACTCCTTTGGCCCGCCCTCGATTTCCACCAAGGAGTACAC
CGCGCACTGGTATGGTCGCACCTTGCACTTCGGTGTTCGCGAGCACGCGATGGGTGCCATCCTGTCCGGCATCGTGCTGC
ACGGACCCACCCGGGCTTACGGCGGCACCTTCCTGCAGTTCTCCGACTACATGCGCCCGGCGGTGCGGCTGGCGGCGTTG
ATGGACATCGACACCATCTACGTCTGGACGCACGACTCGATCGGCCTCGGCGAAGACGGGCCCACCCATCAACCGATCGA
GCACCTCTCGGCGCTGCGCGCGATCCCCCGGCTGTCGGTGGTGCGCCCGGCAGATGCCAACGAGACAGCCTACGCCTGGC
GCACGATCCTGGCCCGCCGCAACGGCAGCGGGCCGGTCGGGTTGATCCTGACCCGCCAGGGTGTGCCGGTGCTGGACGGC
ACCGACGCCGAGGGGGTTGCCCGCGGCGGTTACGTGCTGAGTGACGCCGGTGGTCTGCAACCGGGCGAGGAACCCGACGT
CATTCTCATCGCCACCGGCTCGGAGGTGCAGCTGGCGGTCGCGGCGCAGACGTTGCTGGCGGACAACGACATCCTCGCTC
GGGTGGTGTCGATGCCGTGCCTGGAGTGGTTCGAGGCCCAACCCTACGAGTACCGCGACGCGGTGCTGCCCCCGACGGTG
TCGGCGCGGGTGGCCGTCGAAGCCGGCGTCGCGCAATGCTGGCACCAGCTGGTTGGCGACACGGGCGAGATCGTCTCGAT
CGAGCACTACGGCGAATCCGCGGACCACAAGACCTTGTTCCGCGAGTACGGCTTCACTGCCGAGGCCGTGGCCGCCGCCG
CCGAACGAGCGCTGGATAACTGA

Upstream 100 bases:

>100_bases
ACAGGGCCCGGATGGGTACCCGGATATGCGGCACTGCAAGCGCCGGGATTCCCGCACTAGGGTGAGGACTGATCATCTTG
CTGACTCGAGGACTGAATTT

Downstream 100 bases:

>100_bases
GGAAGGGTGATTACCGATGACCGCTCAGAACCCCAACCTGGCCGCATTGAGCGCCGCGGGGGTATCGGTGTGGCTGGATG
ACCTGTCGCGGGACCGGCTG

Product: transketolase

Products: NA

Alternate protein names: TK [H]

Number of amino acids: Translated: 700; Mature: 699

Protein sequence:

>700_residues
MTTLEEISALTRPRHPDYWTEIDSAAVDTIRVLAADAVQKVGNGHPGTAMSLAPLAYTLFQRTMRHDPSDTHWLGRDRFV
LSAGHSSLTLYIQLYLGGFGLELSDIESLRTWGSKTPGHPEFRHTPGVEITTGPLGQGLASAVGMAMASRYERGLFDPDA
EPGASPFDHYIYVIASDGDIEEGVTSEASSLAAVQQLGNLIVFYDRNQISIEDDTNIALCEDTAARYRAYGWHVQEVEGG
ENVVGIEEAIANAQAVTDRPSFIALRTVIGYPAPNLMDTGKAHGAALGDDEVAAVKKIVGFDPDKTFQVREDVLTHTRGL
VARGKQAHERWQLEFDAWARREPERKALLDRLLAQKLPDGWDADLPHWEPGSKALATRAASGAVLSALGPKLPELWGGSA
DLAGSNNTTIKGADSFGPPSISTKEYTAHWYGRTLHFGVREHAMGAILSGIVLHGPTRAYGGTFLQFSDYMRPAVRLAAL
MDIDTIYVWTHDSIGLGEDGPTHQPIEHLSALRAIPRLSVVRPADANETAYAWRTILARRNGSGPVGLILTRQGVPVLDG
TDAEGVARGGYVLSDAGGLQPGEEPDVILIATGSEVQLAVAAQTLLADNDILARVVSMPCLEWFEAQPYEYRDAVLPPTV
SARVAVEAGVAQCWHQLVGDTGEIVSIEHYGESADHKTLFREYGFTAEAVAAAAERALDN

Sequences:

>Translated_700_residues
MTTLEEISALTRPRHPDYWTEIDSAAVDTIRVLAADAVQKVGNGHPGTAMSLAPLAYTLFQRTMRHDPSDTHWLGRDRFV
LSAGHSSLTLYIQLYLGGFGLELSDIESLRTWGSKTPGHPEFRHTPGVEITTGPLGQGLASAVGMAMASRYERGLFDPDA
EPGASPFDHYIYVIASDGDIEEGVTSEASSLAAVQQLGNLIVFYDRNQISIEDDTNIALCEDTAARYRAYGWHVQEVEGG
ENVVGIEEAIANAQAVTDRPSFIALRTVIGYPAPNLMDTGKAHGAALGDDEVAAVKKIVGFDPDKTFQVREDVLTHTRGL
VARGKQAHERWQLEFDAWARREPERKALLDRLLAQKLPDGWDADLPHWEPGSKALATRAASGAVLSALGPKLPELWGGSA
DLAGSNNTTIKGADSFGPPSISTKEYTAHWYGRTLHFGVREHAMGAILSGIVLHGPTRAYGGTFLQFSDYMRPAVRLAAL
MDIDTIYVWTHDSIGLGEDGPTHQPIEHLSALRAIPRLSVVRPADANETAYAWRTILARRNGSGPVGLILTRQGVPVLDG
TDAEGVARGGYVLSDAGGLQPGEEPDVILIATGSEVQLAVAAQTLLADNDILARVVSMPCLEWFEAQPYEYRDAVLPPTV
SARVAVEAGVAQCWHQLVGDTGEIVSIEHYGESADHKTLFREYGFTAEAVAAAAERALDN
>Mature_699_residues
TTLEEISALTRPRHPDYWTEIDSAAVDTIRVLAADAVQKVGNGHPGTAMSLAPLAYTLFQRTMRHDPSDTHWLGRDRFVL
SAGHSSLTLYIQLYLGGFGLELSDIESLRTWGSKTPGHPEFRHTPGVEITTGPLGQGLASAVGMAMASRYERGLFDPDAE
PGASPFDHYIYVIASDGDIEEGVTSEASSLAAVQQLGNLIVFYDRNQISIEDDTNIALCEDTAARYRAYGWHVQEVEGGE
NVVGIEEAIANAQAVTDRPSFIALRTVIGYPAPNLMDTGKAHGAALGDDEVAAVKKIVGFDPDKTFQVREDVLTHTRGLV
ARGKQAHERWQLEFDAWARREPERKALLDRLLAQKLPDGWDADLPHWEPGSKALATRAASGAVLSALGPKLPELWGGSAD
LAGSNNTTIKGADSFGPPSISTKEYTAHWYGRTLHFGVREHAMGAILSGIVLHGPTRAYGGTFLQFSDYMRPAVRLAALM
DIDTIYVWTHDSIGLGEDGPTHQPIEHLSALRAIPRLSVVRPADANETAYAWRTILARRNGSGPVGLILTRQGVPVLDGT
DAEGVARGGYVLSDAGGLQPGEEPDVILIATGSEVQLAVAAQTLLADNDILARVVSMPCLEWFEAQPYEYRDAVLPPTVS
ARVAVEAGVAQCWHQLVGDTGEIVSIEHYGESADHKTLFREYGFTAEAVAAAAERALDN

Specific function: Unknown

COG id: COG0021

COG function: function code G; Transketolase

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the transketolase family [H]

Homologues:

Organism=Homo sapiens, GI205277463, Length=650, Percent_Identity=24.9230769230769, Blast_Score=140, Evalue=4e-33,
Organism=Homo sapiens, GI4507521, Length=650, Percent_Identity=24.9230769230769, Blast_Score=140, Evalue=4e-33,
Organism=Homo sapiens, GI133778974, Length=610, Percent_Identity=24.4262295081967, Blast_Score=119, Evalue=8e-27,
Organism=Homo sapiens, GI225637459, Length=591, Percent_Identity=21.9966159052453, Blast_Score=103, Evalue=4e-22,
Organism=Homo sapiens, GI225637463, Length=493, Percent_Identity=22.920892494929, Blast_Score=98, Evalue=3e-20,
Organism=Homo sapiens, GI225637461, Length=493, Percent_Identity=22.920892494929, Blast_Score=98, Evalue=3e-20,
Organism=Escherichia coli, GI1788808, Length=677, Percent_Identity=44.903988183161, Blast_Score=539, Evalue=1e-154,
Organism=Escherichia coli, GI48994911, Length=677, Percent_Identity=42.9837518463811, Blast_Score=526, Evalue=1e-150,
Organism=Caenorhabditis elegans, GI17539652, Length=602, Percent_Identity=24.7508305647841, Blast_Score=134, Evalue=2e-31,
Organism=Saccharomyces cerevisiae, GI6325331, Length=687, Percent_Identity=44.6870451237263, Blast_Score=547, Evalue=1e-156,
Organism=Saccharomyces cerevisiae, GI6319593, Length=688, Percent_Identity=43.3139534883721, Blast_Score=525, Evalue=1e-150,
Organism=Drosophila melanogaster, GI45551847, Length=589, Percent_Identity=24.4482173174873, Blast_Score=139, Evalue=8e-33,
Organism=Drosophila melanogaster, GI45550715, Length=589, Percent_Identity=24.4482173174873, Blast_Score=139, Evalue=8e-33,
Organism=Drosophila melanogaster, GI24645119, Length=569, Percent_Identity=24.6045694200351, Blast_Score=124, Evalue=2e-28,
Organism=Drosophila melanogaster, GI24666278, Length=589, Percent_Identity=23.2597623089983, Blast_Score=116, Evalue=7e-26,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR009014
- InterPro:   IPR015941
- InterPro:   IPR005475
- InterPro:   IPR005478
- InterPro:   IPR020826
- InterPro:   IPR005476
- InterPro:   IPR005474 [H]

Pfam domain/function: PF02779 Transket_pyr; PF02780 Transketolase_C; PF00456 Transketolase_N [H]

EC number: =2.2.1.1 [H]

Molecular weight: Translated: 75589; Mature: 75458

Theoretical pI: Translated: 4.78; Mature: 4.78

Prosite motif: PS00801 TRANSKETOLASE_1 ; PS00802 TRANSKETOLASE_2

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.4 %Cys     (Translated Protein)
1.4 %Met     (Translated Protein)
1.9 %Cys+Met (Translated Protein)
0.4 %Cys     (Mature Protein)
1.3 %Met     (Mature Protein)
1.7 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MTTLEEISALTRPRHPDYWTEIDSAAVDTIRVLAADAVQKVGNGHPGTAMSLAPLAYTLF
CCCHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHH
QRTMRHDPSDTHWLGRDRFVLSAGHSSLTLYIQLYLGGFGLELSDIESLRTWGSKTPGHP
HHHHCCCCCCCCCCCCCCEEEECCCCCEEEEEEEEECCCCCCHHHHHHHHHCCCCCCCCC
EFRHTPGVEITTGPLGQGLASAVGMAMASRYERGLFDPDAEPGASPFDHYIYVIASDGDI
CCCCCCCCEEECCCCCHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCEEEEEECCCCC
EEGVTSEASSLAAVQQLGNLIVFYDRNQISIEDDTNIALCEDTAARYRAYGWHVQEVEGG
CCCCHHHHHHHHHHHHHCCEEEEEECCEEEECCCCCEEEECCHHHHHHHCCCEEEEECCC
ENVVGIEEAIANAQAVTDRPSFIALRTVIGYPAPNLMDTGKAHGAALGDDEVAAVKKIVG
CCEEEHHHHHHCCHHHCCCCCCEEEHHHHCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHC
FDPDKTFQVREDVLTHTRGLVARGKQAHERWQLEFDAWARREPERKALLDRLLAQKLPDG
CCCCCCHHHHHHHHHHHHHHHHCCHHHHHHEEEEEHHHHCCCCHHHHHHHHHHHHHCCCC
WDADLPHWEPGSKALATRAASGAVLSALGPKLPELWGGSADLAGSNNTTIKGADSFGPPS
CCCCCCCCCCCCHHHHHHHCCCHHHHHHCCCCHHHCCCCCCCCCCCCCEEECCCCCCCCC
ISTKEYTAHWYGRTLHFGVREHAMGAILSGIVLHGPTRAYGGTFLQFSDYMRPAVRLAAL
CCCCCHHHHHCCCEEECCHHHHHHHHHHHHHHCCCCCHHCCCEEEEHHHHHHHHHHHHHH
MDIDTIYVWTHDSIGLGEDGPTHQPIEHLSALRAIPRLSVVRPADANETAYAWRTILARR
HCCCEEEEEECCCCCCCCCCCCCCHHHHHHHHHHCCCCEEECCCCCCCHHHHHHHHHHHC
NGSGPVGLILTRQGVPVLDGTDAEGVARGGYVLSDAGGLQPGEEPDVILIATGSEVQLAV
CCCCCEEEEEECCCCCEECCCCCCCCCCCCEEEECCCCCCCCCCCCEEEEECCCCEEEEE
AAQTLLADNDILARVVSMPCLEWFEAQPYEYRDAVLPPTVSARVAVEAGVAQCWHQLVGD
HHHHHHCCCHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHCC
TGEIVSIEHYGESADHKTLFREYGFTAEAVAAAAERALDN
CCCEEEEEECCCCCHHHHHHHHHCCCHHHHHHHHHHHCCC
>Mature Secondary Structure 
TTLEEISALTRPRHPDYWTEIDSAAVDTIRVLAADAVQKVGNGHPGTAMSLAPLAYTLF
CCHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHH
QRTMRHDPSDTHWLGRDRFVLSAGHSSLTLYIQLYLGGFGLELSDIESLRTWGSKTPGHP
HHHHCCCCCCCCCCCCCCEEEECCCCCEEEEEEEEECCCCCCHHHHHHHHHCCCCCCCCC
EFRHTPGVEITTGPLGQGLASAVGMAMASRYERGLFDPDAEPGASPFDHYIYVIASDGDI
CCCCCCCCEEECCCCCHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCEEEEEECCCCC
EEGVTSEASSLAAVQQLGNLIVFYDRNQISIEDDTNIALCEDTAARYRAYGWHVQEVEGG
CCCCHHHHHHHHHHHHHCCEEEEEECCEEEECCCCCEEEECCHHHHHHHCCCEEEEECCC
ENVVGIEEAIANAQAVTDRPSFIALRTVIGYPAPNLMDTGKAHGAALGDDEVAAVKKIVG
CCEEEHHHHHHCCHHHCCCCCCEEEHHHHCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHC
FDPDKTFQVREDVLTHTRGLVARGKQAHERWQLEFDAWARREPERKALLDRLLAQKLPDG
CCCCCCHHHHHHHHHHHHHHHHCCHHHHHHEEEEEHHHHCCCCHHHHHHHHHHHHHCCCC
WDADLPHWEPGSKALATRAASGAVLSALGPKLPELWGGSADLAGSNNTTIKGADSFGPPS
CCCCCCCCCCCCHHHHHHHCCCHHHHHHCCCCHHHCCCCCCCCCCCCCEEECCCCCCCCC
ISTKEYTAHWYGRTLHFGVREHAMGAILSGIVLHGPTRAYGGTFLQFSDYMRPAVRLAAL
CCCCCHHHHHCCCEEECCHHHHHHHHHHHHHHCCCCCHHCCCEEEEHHHHHHHHHHHHHH
MDIDTIYVWTHDSIGLGEDGPTHQPIEHLSALRAIPRLSVVRPADANETAYAWRTILARR
HCCCEEEEEECCCCCCCCCCCCCCHHHHHHHHHHCCCCEEECCCCCCCHHHHHHHHHHHC
NGSGPVGLILTRQGVPVLDGTDAEGVARGGYVLSDAGGLQPGEEPDVILIATGSEVQLAV
CCCCCEEEEEECCCCCEECCCCCCCCCCCCEEEECCCCCCCCCCCCEEEEECCCCEEEEE
AAQTLLADNDILARVVSMPCLEWFEAQPYEYRDAVLPPTVSARVAVEAGVAQCWHQLVGD
HHHHHHCCCHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHCC
TGEIVSIEHYGESADHKTLFREYGFTAEAVAAAAERALDN
CCCEEEEEECCCCCHHHHHHHHHCCCHHHHHHHHHHHCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 12788972 [H]