Definition Vibrio splendidus LGP32 chromosome 1, complete genome.
Accession NC_011753
Length 3,299,303

Click here to switch to the map view.

The map label for this gene is tktA [H]

Identifier: 218708231

GI number: 218708231

Start: 164736

End: 166730

Strand: Reverse

Name: tktA [H]

Synonym: VS_0168

Alternate gene names: 218708231

Gene position: 166730-164736 (Counterclockwise)

Preceding gene: 218708232

Following gene: 218708230

Centisome position: 5.05

GC content: 47.62

Gene sequence:

>1995_bases
ATGATTACACGAACTAAATTAGCCGACGCTATTCGCGTTCTAAGCATGGACGCTGTACAAAAAGCAGGCTCGGGCCACCC
CGGAGCACCGATGGGCATGGCCGATATCGCTGAAGTTCTATGGCGTGATTTTCTAAAACACAATCCGAGCAACCCTAACT
GGGCCGACCGCGACCGTTTTATCTTGTCGAATGGCCATGGCTCAATGCTTATCTATAGCTTGTTACACCTATCTGGTTAC
GAGCTATCAATGGATGACATCAAATCTTTCCGTCAATTACACAGTAAAACCGCAGGTCACCCTGAATACGGTTACGCTCC
AGGTATTGAAACCACTACCGGCCCATTAGGACAAGGCATCACCAACGGTGTCGGCATGGCTTTGGCTGAAAAGGTGCTGG
CTGAACAGTTCAACCGTGAAGGCCACGATATTGTTGATCACCACACCTACGTGTTCATGGGCGACGGCTGCATGATGGAA
GGTATTTCTCATGAAGCATGTTCACTTGCCGGTACGCTTGGACTAGGGAAGCTGGTCGCTTTTTGGGATGACAATGGCAT
TTCGATTGATGGCGAAGTCGACGGCTGGTTCTCTGATGACACACCAAAACGTTTTGAAGCCTACGGTTGGCATGTTATTG
CTGATGTTGATGGTCATAACGCTGATGATATTCACAAAGCGATTACTGAAGCTAAAGCCGTAACAGATAAACCAACCTTA
ATTTGCTGCAAAACCGTGATTGGTTTTGGCTCACCAAACAAGTCAGCCAGTCATGACTGTCATGGTGCTCCGTTAGGTGC
TGATGAAGTCGCATTGGTTCGACTCAACCTCGGCTGGGACCATCCTGAATTTGAAATTCCTCAAGATGTATACCAAGCAT
GGGATGGGAAAGATAAAGGACAAAGCAATGAAGATGACTGGCAAACACGTTTCAATGCTTATCAAGAGGCGCACCCAGAA
TTAGCCGCTGAGTTTTTGCGTCGTAGCCAGAACCTATTACCTGAAAATTGGGATCAGCACACTCAAGATCTAATCCAGAC
TTTGCAAGCGAATCCACAAACCATCGCGACTCGCAAAGCATCACAAAATACTATAGAAGCATTCGGACCATTACTGCCTG
AGTTTTTGGGAGGTTCAGCCGATTTAACCCCTTCAAATTTAACTAACTGGTCAGGCTCAAAAGCAATTACCGCTCAAGAT
GCGTCAGGAAACTACTTGAGTTACGGCGTTCGTGAATTTGCGATGTCTGCAATGATGAATGGCGTGGCGTTGCATGGTGG
CTTTATCCCATACGGCGGTACGTTCTTGATGTTCATGGAGTACGCTCGTAACGCGCTTCGTATGGCAGCACTAATGAAGC
AACGCAGTATCTTCGTTTATACCCATGACTCTATCGGTTTGGGGGAAGATGGTCCGACACACCAACCGGTTGAACAAATC
GCATCGCTTCGACTTACCCCAAACATGAGCACTTGGCGTCCTTGCGACCAAGTAGAAACCGCGGTGGCTTGGAAGTCTGC
TATCGAACGTTTTGATGGCCCAACGTCATTGATTTTCTCTCGCCAGAATCTTGTTCAATTCGAGCGTGATCAAGACACGC
TTTCCAATGTAGCGAAAGGTGGATACATCCTTTCTGACTGTGAAGGTGACCCACAGCTGATTCTAATCGCTACGGGCTCT
GAAGTAGCACTCGCCATGGAAGCAAAAGCACAACTCAGCCATGTTCGCTGCCGCGTAGTTTCAATGCCGGCCACCGATAT
TTTTGACGCACAAAGTGCGGAATACAAGGAGCAGGTTTTACCAAGCCATGTTACAGCACGAGTTGCCATAGAGGCTGGTA
TCCGTGACTACTGGTTCAAGTATGTCGGGCTACACGGCGACATTGTGGGAATGACAAGCTTTGGTGAATCAGCACCAGCA
GAACAACTCTTCGAAATGTTTGGATTTACGGTTGAAAATATCGTTGAAAAATCCCTATCGGTTCTGGAGAAGTAA

Upstream 100 bases:

>100_bases
CCGATGGCAACAGAAAAGCTAGCCGAAGGCATCCGTAACTTTGCCGTCGATCAAGGCAAGTTAGAAACCATGATCGAAGC
ACGCCTGTAGGAGAAGCATA

Downstream 100 bases:

>100_bases
TATGAGCATGGCACAACGCTTTATTGAAAACCAAAGCCAAGACTGCCTGCGAACTAAGGCTGCAAAAGTAGCCTTAGAGC
AAGTCCTAAAAACGCTAACA

Product: transketolase 2

Products: NA

Alternate protein names: TK 1 [H]

Number of amino acids: Translated: 664; Mature: 664

Protein sequence:

>664_residues
MITRTKLADAIRVLSMDAVQKAGSGHPGAPMGMADIAEVLWRDFLKHNPSNPNWADRDRFILSNGHGSMLIYSLLHLSGY
ELSMDDIKSFRQLHSKTAGHPEYGYAPGIETTTGPLGQGITNGVGMALAEKVLAEQFNREGHDIVDHHTYVFMGDGCMME
GISHEACSLAGTLGLGKLVAFWDDNGISIDGEVDGWFSDDTPKRFEAYGWHVIADVDGHNADDIHKAITEAKAVTDKPTL
ICCKTVIGFGSPNKSASHDCHGAPLGADEVALVRLNLGWDHPEFEIPQDVYQAWDGKDKGQSNEDDWQTRFNAYQEAHPE
LAAEFLRRSQNLLPENWDQHTQDLIQTLQANPQTIATRKASQNTIEAFGPLLPEFLGGSADLTPSNLTNWSGSKAITAQD
ASGNYLSYGVREFAMSAMMNGVALHGGFIPYGGTFLMFMEYARNALRMAALMKQRSIFVYTHDSIGLGEDGPTHQPVEQI
ASLRLTPNMSTWRPCDQVETAVAWKSAIERFDGPTSLIFSRQNLVQFERDQDTLSNVAKGGYILSDCEGDPQLILIATGS
EVALAMEAKAQLSHVRCRVVSMPATDIFDAQSAEYKEQVLPSHVTARVAIEAGIRDYWFKYVGLHGDIVGMTSFGESAPA
EQLFEMFGFTVENIVEKSLSVLEK

Sequences:

>Translated_664_residues
MITRTKLADAIRVLSMDAVQKAGSGHPGAPMGMADIAEVLWRDFLKHNPSNPNWADRDRFILSNGHGSMLIYSLLHLSGY
ELSMDDIKSFRQLHSKTAGHPEYGYAPGIETTTGPLGQGITNGVGMALAEKVLAEQFNREGHDIVDHHTYVFMGDGCMME
GISHEACSLAGTLGLGKLVAFWDDNGISIDGEVDGWFSDDTPKRFEAYGWHVIADVDGHNADDIHKAITEAKAVTDKPTL
ICCKTVIGFGSPNKSASHDCHGAPLGADEVALVRLNLGWDHPEFEIPQDVYQAWDGKDKGQSNEDDWQTRFNAYQEAHPE
LAAEFLRRSQNLLPENWDQHTQDLIQTLQANPQTIATRKASQNTIEAFGPLLPEFLGGSADLTPSNLTNWSGSKAITAQD
ASGNYLSYGVREFAMSAMMNGVALHGGFIPYGGTFLMFMEYARNALRMAALMKQRSIFVYTHDSIGLGEDGPTHQPVEQI
ASLRLTPNMSTWRPCDQVETAVAWKSAIERFDGPTSLIFSRQNLVQFERDQDTLSNVAKGGYILSDCEGDPQLILIATGS
EVALAMEAKAQLSHVRCRVVSMPATDIFDAQSAEYKEQVLPSHVTARVAIEAGIRDYWFKYVGLHGDIVGMTSFGESAPA
EQLFEMFGFTVENIVEKSLSVLEK
>Mature_664_residues
MITRTKLADAIRVLSMDAVQKAGSGHPGAPMGMADIAEVLWRDFLKHNPSNPNWADRDRFILSNGHGSMLIYSLLHLSGY
ELSMDDIKSFRQLHSKTAGHPEYGYAPGIETTTGPLGQGITNGVGMALAEKVLAEQFNREGHDIVDHHTYVFMGDGCMME
GISHEACSLAGTLGLGKLVAFWDDNGISIDGEVDGWFSDDTPKRFEAYGWHVIADVDGHNADDIHKAITEAKAVTDKPTL
ICCKTVIGFGSPNKSASHDCHGAPLGADEVALVRLNLGWDHPEFEIPQDVYQAWDGKDKGQSNEDDWQTRFNAYQEAHPE
LAAEFLRRSQNLLPENWDQHTQDLIQTLQANPQTIATRKASQNTIEAFGPLLPEFLGGSADLTPSNLTNWSGSKAITAQD
ASGNYLSYGVREFAMSAMMNGVALHGGFIPYGGTFLMFMEYARNALRMAALMKQRSIFVYTHDSIGLGEDGPTHQPVEQI
ASLRLTPNMSTWRPCDQVETAVAWKSAIERFDGPTSLIFSRQNLVQFERDQDTLSNVAKGGYILSDCEGDPQLILIATGS
EVALAMEAKAQLSHVRCRVVSMPATDIFDAQSAEYKEQVLPSHVTARVAIEAGIRDYWFKYVGLHGDIVGMTSFGESAPA
EQLFEMFGFTVENIVEKSLSVLEK

Specific function: Unknown

COG id: COG0021

COG function: function code G; Transketolase

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the transketolase family [H]

Homologues:

Organism=Homo sapiens, GI205277463, Length=580, Percent_Identity=25.8620689655172, Blast_Score=158, Evalue=2e-38,
Organism=Homo sapiens, GI4507521, Length=580, Percent_Identity=25.8620689655172, Blast_Score=158, Evalue=2e-38,
Organism=Homo sapiens, GI133778974, Length=676, Percent_Identity=25.2958579881657, Blast_Score=138, Evalue=2e-32,
Organism=Homo sapiens, GI225637459, Length=672, Percent_Identity=22.6190476190476, Blast_Score=110, Evalue=5e-24,
Organism=Homo sapiens, GI225637461, Length=644, Percent_Identity=22.360248447205, Blast_Score=97, Evalue=5e-20,
Organism=Homo sapiens, GI225637463, Length=640, Percent_Identity=22.65625, Blast_Score=95, Evalue=2e-19,
Organism=Escherichia coli, GI48994911, Length=664, Percent_Identity=71.2349397590361, Blast_Score=1026, Evalue=0.0,
Organism=Escherichia coli, GI1788808, Length=663, Percent_Identity=67.2699849170437, Blast_Score=970, Evalue=0.0,
Organism=Caenorhabditis elegans, GI17539652, Length=669, Percent_Identity=24.0657698056801, Blast_Score=142, Evalue=8e-34,
Organism=Saccharomyces cerevisiae, GI6325331, Length=669, Percent_Identity=47.3841554559043, Blast_Score=588, Evalue=1e-169,
Organism=Saccharomyces cerevisiae, GI6319593, Length=667, Percent_Identity=43.7781109445277, Blast_Score=544, Evalue=1e-155,
Organism=Drosophila melanogaster, GI24666278, Length=680, Percent_Identity=22.9411764705882, Blast_Score=137, Evalue=3e-32,
Organism=Drosophila melanogaster, GI45551847, Length=274, Percent_Identity=32.8467153284672, Blast_Score=126, Evalue=6e-29,
Organism=Drosophila melanogaster, GI45550715, Length=274, Percent_Identity=32.8467153284672, Blast_Score=126, Evalue=6e-29,
Organism=Drosophila melanogaster, GI24645119, Length=242, Percent_Identity=32.2314049586777, Blast_Score=103, Evalue=5e-22,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR009014
- InterPro:   IPR015941
- InterPro:   IPR005475
- InterPro:   IPR005478
- InterPro:   IPR020826
- InterPro:   IPR005476
- InterPro:   IPR005474 [H]

Pfam domain/function: PF02779 Transket_pyr; PF02780 Transketolase_C; PF00456 Transketolase_N [H]

EC number: =2.2.1.1 [H]

Molecular weight: Translated: 72915; Mature: 72915

Theoretical pI: Translated: 4.78; Mature: 4.78

Prosite motif: PS00801 TRANSKETOLASE_1 ; PS00802 TRANSKETOLASE_2

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.2 %Cys     (Translated Protein)
3.3 %Met     (Translated Protein)
4.5 %Cys+Met (Translated Protein)
1.2 %Cys     (Mature Protein)
3.3 %Met     (Mature Protein)
4.5 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MITRTKLADAIRVLSMDAVQKAGSGHPGAPMGMADIAEVLWRDFLKHNPSNPNWADRDRF
CCCHHHHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHCCCCCCCCCCCCCE
ILSNGHGSMLIYSLLHLSGYELSMDDIKSFRQLHSKTAGHPEYGYAPGIETTTGPLGQGI
EEECCCCHHHHHHHHHHCCCCCCHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCH
TNGVGMALAEKVLAEQFNREGHDIVDHHTYVFMGDGCMMEGISHEACSLAGTLGLGKLVA
HHHHHHHHHHHHHHHHHCCCCCCCCCCCEEEEECCCHHCCCCCHHHHHHHHHHCCCCEEE
FWDDNGISIDGEVDGWFSDDTPKRFEAYGWHVIADVDGHNADDIHKAITEAKAVTDKPTL
EECCCCEEECCCCCCCCCCCCCHHHHHCCCEEEEECCCCCHHHHHHHHHHHHHCCCCCCE
ICCKTVIGFGSPNKSASHDCHGAPLGADEVALVRLNLGWDHPEFEIPQDVYQAWDGKDKG
EEEHHHHCCCCCCCCCCCCCCCCCCCCCCEEEEEEECCCCCCCCCCCHHHHHHCCCCCCC
QSNEDDWQTRFNAYQEAHPELAAEFLRRSQNLLPENWDQHTQDLIQTLQANPQTIATRKA
CCCCHHHHHHHHHHHHCCHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHCCCHHHHHHCC
SQNTIEAFGPLLPEFLGGSADLTPSNLTNWSGSKAITAQDASGNYLSYGVREFAMSAMMN
CCHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCEEEEECCCCCHHHHHHHHHHHHHHHC
GVALHGGFIPYGGTFLMFMEYARNALRMAALMKQRSIFVYTHDSIGLGEDGPTHQPVEQI
CEEEECCCCCCCHHHHHHHHHHHHHHHHHHHHHHCEEEEEECCCCCCCCCCCCCHHHHHH
ASLRLTPNMSTWRPCDQVETAVAWKSAIERFDGPTSLIFSRQNLVQFERDQDTLSNVAKG
HHEECCCCCCCCCCHHHHHHHHHHHHHHHHCCCCHHHHCCHHHHHHHHCCHHHHHHHHCC
GYILSDCEGDPQLILIATGSEVALAMEAKAQLSHVRCRVVSMPATDIFDAQSAEYKEQVL
CEEEECCCCCCCEEEEECCCCEEEEHHHHHHHHHHEEEEEECCCHHHCCCCCHHHHHHHC
PSHVTARVAIEAGIRDYWFKYVGLHGDIVGMTSFGESAPAEQLFEMFGFTVENIVEKSLS
CHHHHHHHHHHHHHHHHHHHHHCCCCCEEEECCCCCCCCHHHHHHHHCCHHHHHHHHHHH
VLEK
HHCC
>Mature Secondary Structure
MITRTKLADAIRVLSMDAVQKAGSGHPGAPMGMADIAEVLWRDFLKHNPSNPNWADRDRF
CCCHHHHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHCCCCCCCCCCCCCE
ILSNGHGSMLIYSLLHLSGYELSMDDIKSFRQLHSKTAGHPEYGYAPGIETTTGPLGQGI
EEECCCCHHHHHHHHHHCCCCCCHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCH
TNGVGMALAEKVLAEQFNREGHDIVDHHTYVFMGDGCMMEGISHEACSLAGTLGLGKLVA
HHHHHHHHHHHHHHHHHCCCCCCCCCCCEEEEECCCHHCCCCCHHHHHHHHHHCCCCEEE
FWDDNGISIDGEVDGWFSDDTPKRFEAYGWHVIADVDGHNADDIHKAITEAKAVTDKPTL
EECCCCEEECCCCCCCCCCCCCHHHHHCCCEEEEECCCCCHHHHHHHHHHHHHCCCCCCE
ICCKTVIGFGSPNKSASHDCHGAPLGADEVALVRLNLGWDHPEFEIPQDVYQAWDGKDKG
EEEHHHHCCCCCCCCCCCCCCCCCCCCCCEEEEEEECCCCCCCCCCCHHHHHHCCCCCCC
QSNEDDWQTRFNAYQEAHPELAAEFLRRSQNLLPENWDQHTQDLIQTLQANPQTIATRKA
CCCCHHHHHHHHHHHHCCHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHCCCHHHHHHCC
SQNTIEAFGPLLPEFLGGSADLTPSNLTNWSGSKAITAQDASGNYLSYGVREFAMSAMMN
CCHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCEEEEECCCCCHHHHHHHHHHHHHHHC
GVALHGGFIPYGGTFLMFMEYARNALRMAALMKQRSIFVYTHDSIGLGEDGPTHQPVEQI
CEEEECCCCCCCHHHHHHHHHHHHHHHHHHHHHHCEEEEEECCCCCCCCCCCCCHHHHHH
ASLRLTPNMSTWRPCDQVETAVAWKSAIERFDGPTSLIFSRQNLVQFERDQDTLSNVAKG
HHEECCCCCCCCCCHHHHHHHHHHHHHHHHCCCCHHHHCCHHHHHHHHCCHHHHHHHHCC
GYILSDCEGDPQLILIATGSEVALAMEAKAQLSHVRCRVVSMPATDIFDAQSAEYKEQVL
CEEEECCCCCCCEEEEECCCCEEEEHHHHHHHHHHEEEEEECCCHHHCCCCCHHHHHHHC
PSHVTARVAIEAGIRDYWFKYVGLHGDIVGMTSFGESAPAEQLFEMFGFTVENIVEKSLS
CHHHHHHHHHHHHHHHHHHHHHCCCCCEEEECCCCCCCCHHHHHHHHCCHHHHHHHHHHH
VLEK
HHCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 10952301 [H]