| Definition | Ruegeria sp. TM1040, complete genome. |
|---|---|
| Accession | NC_008044 |
| Length | 3,200,938 |
Click here to switch to the map view.
The map label for this gene is tktA [H]
Identifier: 99080954
GI number: 99080954
Start: 1194349
End: 1196370
Strand: Reverse
Name: tktA [H]
Synonym: TM1040_1113
Alternate gene names: 99080954
Gene position: 1196370-1194349 (Counterclockwise)
Preceding gene: 99080957
Following gene: 99080952
Centisome position: 37.38
GC content: 62.56
Gene sequence:
>2022_bases GTGGATCTGACAGCCCTGCGCTCTGAAAACCCCGATCATTGGAACAAAGCCGCCGCCATCCGCGCCCTGACGCTGGATGC GGTTGCGGGTGCAAACTCCGGCCACTCCGGCATGCCGATTGGCATGGCCGATGTCGCAACCGTGCTGTTTGAAAAGCACA TGAAGTTCGACGTCTCCGCCCCCAAATGGGCGGACCGCGATCGCTTCATCCTGTCGGCCGGCCACGGCTCCATGCTGATC TATTCGCTGCTCTACCTCATGGGCGACGCACAGGTCACGCTCGAGCAGATCAAGAACTTCCGTCAGTCCGGCGCGCTCAC GGCGGGCCACCCGGAGAACTTTCTTCTGGACGCGGTCGAAGTCACCACCGGCCCGCTTGGCCAGGGGATCTCGAACGCTG TCGGCTTTGCCATGGCCGAGGAAAGCCTGCGCGCCCAGTATGGCAAGAAGGTTGTCGATCACTACACCTATGTCATCGCG GGCGACGGCTGCCTCATGGAAGGCGTGAGCCAGGAGGCAATCGGCCTTGCCGGGCGTCACCAGCTGGGCAAGCTCGTGGT GTTCTGGGACAACAACAACATCACCATCGACGGCACCGTTGATCTCTCTGATCGCACCAATCAGGTGCAGCGCTTCAAAG CGTCCGGTTGGCATGTGCAGGAAATCGACGGCCATAACCCGGCCGAGATCGACGCCGCCATCGAGGCCGCGAAGAAGACC AAGAAACCGTCGATGATCGCCTGCAAAACCCATATCGCTCTGGGTCACGCTGCGCAGGATACCTCCAAAGGCCACGGCGC TCTGACCGACGCCGATCAGCTCAAAGCCGCCAAGGAAGCCTATGGCTGGACCGGTGGCGCCTATGAGGTGCCCGCCGAGA TCAAATCCCAGTGGGAAGCGATCGGCCAGCGCGGTGCTACGGCGCGCGCTGAATGGGAAGCGCGTTTTGCCGAGATTTCC AAGCAGAAACAGGACCGGTTCAACCGGGCCTTTGCCCTTGAGGCGCCGAAGAAGCTCTCCGCGACCGTGAAGGCGCTGAA AAAGCAGATCTCGGAAACCAAACCCAAGGTGGCAACCCGCAAGGCGTCGGAAATGGCGCTTGAGGTCATCAACCCGATCA TGCCCGAAACCATTGGCGGCTCGGCGGATCTCACCGGCTCCAACAACACCAAGACCGGCGATCTTGGGGTGTTTGACACC GACAACCGCAAGGGCCGCTATGTCTATTGGGGCATCCGCGAGCATGGTATGGCGGCAGCGATGAACGGCATGGCGCTGCA TGGCGGTATTCGCCCCTATGGCGGGACGTTCTTCTGCTTTACCGATTATGCGCGTCCGGCCATGCGTCTGGCGGCCCTGT CGAAGATCCCGACGGTCTTTGTGATGACCCACGATTCCATCGGTGTGGGCGAAGATGGCCCGACCCACCAGCCGGTCGAG CATCTCGCGATCTGTCGCGCGACCCCGAACACCTATACCTTCCGCCCTGCCGACGCGGTGGAAACCGCAGAAGCCTGGGA AATCGCGCTGACGGCCAAGGAAACCCCGTCGGTGATCGCGCTCACGCGTCAGGGCCTGCCCACCGTGCGCACCGAGCACA AGCTGGCCAACCTCACCGAGAAAGGCGCCTATGTGCTGGCCGAGGCCGAGAGCAAGCGTCAGGTGATCCTGATGGCTTCC GGCTCCGAAGTGTCGGTTGCGATGGCTGCAAAAGACATCCTCGAGGGTCAAGGCATCGGCACCCGCGTGGTCTCTGTGCC CTGCATGGAGCTGTTCCACGCGCAGGACGAAGCCTACCGCCGCAAGGTTCTGCCCGCAGGTCCCGTGCGCGTGGCCATCG AGGCCGCCGTGCGCGATGGCGGCTGGGATCGCCTCTTGCTGGGGGAACGCGGCCAGGAGAAGAAGGCAGGCTTTGTCGGC ATGCAGGGCTTTGGTGCTTCTGCCCCGGCGGGTGAGCTCTTTGAGAAATTCGGCATTACCGCCGAAGGCACCGTCGCCAA GGTCAAAGAGCTGTTGGGCTAA
Upstream 100 bases:
>100_bases GAGTGGCGAAACCCCGCAAAACAGGGCCTCAGCGCTTGATCTTTGCTTTGAGACTGCTATCCAGCGGCAAACCCCTGCGA ACCCAAAGAGGAACAGTTCA
Downstream 100 bases:
>100_bases GCCGGGTGCTGGGGGCGCTGCCCCCGACCCTTTCGGGTCTCCCCCGGGATATTTTGAGTTAGAAGATGAAAGGGCGCCCC GGGTTTGGGGCGCCCTTTTT
Product: transketolase
Products: NA
Alternate protein names: TK [H]
Number of amino acids: Translated: 673; Mature: 673
Protein sequence:
>673_residues MDLTALRSENPDHWNKAAAIRALTLDAVAGANSGHSGMPIGMADVATVLFEKHMKFDVSAPKWADRDRFILSAGHGSMLI YSLLYLMGDAQVTLEQIKNFRQSGALTAGHPENFLLDAVEVTTGPLGQGISNAVGFAMAEESLRAQYGKKVVDHYTYVIA GDGCLMEGVSQEAIGLAGRHQLGKLVVFWDNNNITIDGTVDLSDRTNQVQRFKASGWHVQEIDGHNPAEIDAAIEAAKKT KKPSMIACKTHIALGHAAQDTSKGHGALTDADQLKAAKEAYGWTGGAYEVPAEIKSQWEAIGQRGATARAEWEARFAEIS KQKQDRFNRAFALEAPKKLSATVKALKKQISETKPKVATRKASEMALEVINPIMPETIGGSADLTGSNNTKTGDLGVFDT DNRKGRYVYWGIREHGMAAAMNGMALHGGIRPYGGTFFCFTDYARPAMRLAALSKIPTVFVMTHDSIGVGEDGPTHQPVE HLAICRATPNTYTFRPADAVETAEAWEIALTAKETPSVIALTRQGLPTVRTEHKLANLTEKGAYVLAEAESKRQVILMAS GSEVSVAMAAKDILEGQGIGTRVVSVPCMELFHAQDEAYRRKVLPAGPVRVAIEAAVRDGGWDRLLLGERGQEKKAGFVG MQGFGASAPAGELFEKFGITAEGTVAKVKELLG
Sequences:
>Translated_673_residues MDLTALRSENPDHWNKAAAIRALTLDAVAGANSGHSGMPIGMADVATVLFEKHMKFDVSAPKWADRDRFILSAGHGSMLI YSLLYLMGDAQVTLEQIKNFRQSGALTAGHPENFLLDAVEVTTGPLGQGISNAVGFAMAEESLRAQYGKKVVDHYTYVIA GDGCLMEGVSQEAIGLAGRHQLGKLVVFWDNNNITIDGTVDLSDRTNQVQRFKASGWHVQEIDGHNPAEIDAAIEAAKKT KKPSMIACKTHIALGHAAQDTSKGHGALTDADQLKAAKEAYGWTGGAYEVPAEIKSQWEAIGQRGATARAEWEARFAEIS KQKQDRFNRAFALEAPKKLSATVKALKKQISETKPKVATRKASEMALEVINPIMPETIGGSADLTGSNNTKTGDLGVFDT DNRKGRYVYWGIREHGMAAAMNGMALHGGIRPYGGTFFCFTDYARPAMRLAALSKIPTVFVMTHDSIGVGEDGPTHQPVE HLAICRATPNTYTFRPADAVETAEAWEIALTAKETPSVIALTRQGLPTVRTEHKLANLTEKGAYVLAEAESKRQVILMAS GSEVSVAMAAKDILEGQGIGTRVVSVPCMELFHAQDEAYRRKVLPAGPVRVAIEAAVRDGGWDRLLLGERGQEKKAGFVG MQGFGASAPAGELFEKFGITAEGTVAKVKELLG >Mature_673_residues MDLTALRSENPDHWNKAAAIRALTLDAVAGANSGHSGMPIGMADVATVLFEKHMKFDVSAPKWADRDRFILSAGHGSMLI YSLLYLMGDAQVTLEQIKNFRQSGALTAGHPENFLLDAVEVTTGPLGQGISNAVGFAMAEESLRAQYGKKVVDHYTYVIA GDGCLMEGVSQEAIGLAGRHQLGKLVVFWDNNNITIDGTVDLSDRTNQVQRFKASGWHVQEIDGHNPAEIDAAIEAAKKT KKPSMIACKTHIALGHAAQDTSKGHGALTDADQLKAAKEAYGWTGGAYEVPAEIKSQWEAIGQRGATARAEWEARFAEIS KQKQDRFNRAFALEAPKKLSATVKALKKQISETKPKVATRKASEMALEVINPIMPETIGGSADLTGSNNTKTGDLGVFDT DNRKGRYVYWGIREHGMAAAMNGMALHGGIRPYGGTFFCFTDYARPAMRLAALSKIPTVFVMTHDSIGVGEDGPTHQPVE HLAICRATPNTYTFRPADAVETAEAWEIALTAKETPSVIALTRQGLPTVRTEHKLANLTEKGAYVLAEAESKRQVILMAS GSEVSVAMAAKDILEGQGIGTRVVSVPCMELFHAQDEAYRRKVLPAGPVRVAIEAAVRDGGWDRLLLGERGQEKKAGFVG MQGFGASAPAGELFEKFGITAEGTVAKVKELLG
Specific function: Unknown
COG id: COG0021
COG function: function code G; Transketolase
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the transketolase family [H]
Homologues:
Organism=Homo sapiens, GI205277463, Length=583, Percent_Identity=25.9005145797599, Blast_Score=148, Evalue=1e-35, Organism=Homo sapiens, GI4507521, Length=583, Percent_Identity=25.9005145797599, Blast_Score=148, Evalue=1e-35, Organism=Homo sapiens, GI133778974, Length=662, Percent_Identity=25.0755287009063, Blast_Score=141, Evalue=2e-33, Organism=Homo sapiens, GI225637459, Length=681, Percent_Identity=23.3480176211454, Blast_Score=103, Evalue=4e-22, Organism=Homo sapiens, GI225637461, Length=652, Percent_Identity=23.4662576687117, Blast_Score=96, Evalue=1e-19, Organism=Homo sapiens, GI225637463, Length=649, Percent_Identity=23.5747303543914, Blast_Score=95, Evalue=2e-19, Organism=Escherichia coli, GI48994911, Length=667, Percent_Identity=46.7766116941529, Blast_Score=570, Evalue=1e-163, Organism=Escherichia coli, GI1788808, Length=669, Percent_Identity=45.2914798206278, Blast_Score=546, Evalue=1e-156, Organism=Caenorhabditis elegans, GI17539652, Length=683, Percent_Identity=27.2327964860908, Blast_Score=159, Evalue=6e-39, Organism=Saccharomyces cerevisiae, GI6325331, Length=669, Percent_Identity=42.3019431988042, Blast_Score=461, Evalue=1e-130, Organism=Saccharomyces cerevisiae, GI6319593, Length=676, Percent_Identity=40.3846153846154, Blast_Score=452, Evalue=1e-128, Organism=Drosophila melanogaster, GI45551847, Length=677, Percent_Identity=25.4062038404727, Blast_Score=157, Evalue=2e-38, Organism=Drosophila melanogaster, GI45550715, Length=677, Percent_Identity=25.4062038404727, Blast_Score=157, Evalue=2e-38, Organism=Drosophila melanogaster, GI24645119, Length=633, Percent_Identity=25.434439178515, Blast_Score=146, Evalue=6e-35, Organism=Drosophila melanogaster, GI24666278, Length=239, Percent_Identity=31.7991631799163, Blast_Score=107, Evalue=4e-23,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR009014 - InterPro: IPR015941 - InterPro: IPR005475 - InterPro: IPR005478 - InterPro: IPR020826 - InterPro: IPR005476 - InterPro: IPR005474 [H]
Pfam domain/function: PF02779 Transket_pyr; PF02780 Transketolase_C; PF00456 Transketolase_N [H]
EC number: =2.2.1.1 [H]
Molecular weight: Translated: 72384; Mature: 72384
Theoretical pI: Translated: 7.05; Mature: 7.05
Prosite motif: PS00802 TRANSKETOLASE_2
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.7 %Cys (Translated Protein) 3.0 %Met (Translated Protein) 3.7 %Cys+Met (Translated Protein) 0.7 %Cys (Mature Protein) 3.0 %Met (Mature Protein) 3.7 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MDLTALRSENPDHWNKAAAIRALTLDAVAGANSGHSGMPIGMADVATVLFEKHMKFDVSA CCCCCCCCCCCCHHHHHHHHHEEEEHHHCCCCCCCCCCCCCHHHHHHHHHHHHCCEECCC PKWADRDRFILSAGHGSMLIYSLLYLMGDAQVTLEQIKNFRQSGALTAGHPENFLLDAVE CCCCCCCCEEEECCCCHHHHHHHHHHHCCCHHHHHHHHHHHHHCCEECCCCCCCEEEEHH VTTGPLGQGISNAVGFAMAEESLRAQYGKKVVDHYTYVIAGDGCLMEGVSQEAIGLAGRH HCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHCEEEEEECCCHHHCCCCHHHHCCCCCC QLGKLVVFWDNNNITIDGTVDLSDRTNQVQRFKASGWHVQEIDGHNPAEIDAAIEAAKKT CCCCEEEEECCCEEEEEEEEECCCCHHHHHHHHCCCCEEEECCCCCCHHHHHHHHHHHHC KKPSMIACKTHIALGHAAQDTSKGHGALTDADQLKAAKEAYGWTGGAYEVPAEIKSQWEA CCCCEEEEEEHEEECCCCCCCCCCCCCCCCHHHHHHHHHHCCCCCCCEECCHHHHHHHHH IGQRGATARAEWEARFAEISKQKQDRFNRAFALEAPKKLSATVKALKKQISETKPKVATR HHHCCCCCHHHHHHHHHHHHHHHHHHHCCEEEECCCHHHHHHHHHHHHHHHHCCCHHHHH KASEMALEVINPIMPETIGGSADLTGSNNTKTGDLGVFDTDNRKGRYVYWGIREHGMAAA HHHHHHHHHHHHHCCCCCCCCEECCCCCCCCCCCCCEEECCCCCCCEEEEEHHHCCHHHH MNGMALHGGIRPYGGTFFCFTDYARPAMRLAALSKIPTVFVMTHDSIGVGEDGPTHQPVE HCCEEEECCCCCCCCEEEEEECCCHHHHHHHHHHHCCEEEEEEECCCCCCCCCCCCCCHH HLAICRATPNTYTFRPADAVETAEAWEIALTAKETPSVIALTRQGLPTVRTEHKLANLTE HHEEEECCCCCEEECCCCHHHCCCCEEEEEECCCCCCEEEEECCCCCCCHHHHHHHHHHC KGAYVLAEAESKRQVILMASGSEVSVAMAAKDILEGQGIGTRVVSVPCMELFHAQDEAYR CCCEEEEECCCCCEEEEEECCCCEEEHHHHHHHHCCCCCCEEEEHHHHHHHHHHHHHHHH RKVLPAGPVRVAIEAAVRDGGWDRLLLGERGQEKKAGFVGMQGFGASAPAGELFEKFGIT HHCCCCCCCEEEEEEECCCCCCCEEEECCCCCCCCCCEEEECCCCCCCCHHHHHHHHCCC AEGTVAKVKELLG CCCHHHHHHHHHC >Mature Secondary Structure MDLTALRSENPDHWNKAAAIRALTLDAVAGANSGHSGMPIGMADVATVLFEKHMKFDVSA CCCCCCCCCCCCHHHHHHHHHEEEEHHHCCCCCCCCCCCCCHHHHHHHHHHHHCCEECCC PKWADRDRFILSAGHGSMLIYSLLYLMGDAQVTLEQIKNFRQSGALTAGHPENFLLDAVE CCCCCCCCEEEECCCCHHHHHHHHHHHCCCHHHHHHHHHHHHHCCEECCCCCCCEEEEHH VTTGPLGQGISNAVGFAMAEESLRAQYGKKVVDHYTYVIAGDGCLMEGVSQEAIGLAGRH HCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHCEEEEEECCCHHHCCCCHHHHCCCCCC QLGKLVVFWDNNNITIDGTVDLSDRTNQVQRFKASGWHVQEIDGHNPAEIDAAIEAAKKT CCCCEEEEECCCEEEEEEEEECCCCHHHHHHHHCCCCEEEECCCCCCHHHHHHHHHHHHC KKPSMIACKTHIALGHAAQDTSKGHGALTDADQLKAAKEAYGWTGGAYEVPAEIKSQWEA CCCCEEEEEEHEEECCCCCCCCCCCCCCCCHHHHHHHHHHCCCCCCCEECCHHHHHHHHH IGQRGATARAEWEARFAEISKQKQDRFNRAFALEAPKKLSATVKALKKQISETKPKVATR HHHCCCCCHHHHHHHHHHHHHHHHHHHCCEEEECCCHHHHHHHHHHHHHHHHCCCHHHHH KASEMALEVINPIMPETIGGSADLTGSNNTKTGDLGVFDTDNRKGRYVYWGIREHGMAAA HHHHHHHHHHHHHCCCCCCCCEECCCCCCCCCCCCCEEECCCCCCCEEEEEHHHCCHHHH MNGMALHGGIRPYGGTFFCFTDYARPAMRLAALSKIPTVFVMTHDSIGVGEDGPTHQPVE HCCEEEECCCCCCCCEEEEEECCCHHHHHHHHHHHCCEEEEEEECCCCCCCCCCCCCCHH HLAICRATPNTYTFRPADAVETAEAWEIALTAKETPSVIALTRQGLPTVRTEHKLANLTE HHEEEECCCCCEEECCCCHHHCCCCEEEEEECCCCCCEEEEECCCCCCCHHHHHHHHHHC KGAYVLAEAESKRQVILMASGSEVSVAMAAKDILEGQGIGTRVVSVPCMELFHAQDEAYR CCCEEEEECCCCCEEEEEECCCCEEEHHHHHHHHCCCCCCEEEEHHHHHHHHHHHHHHHH RKVLPAGPVRVAIEAAVRDGGWDRLLLGERGQEKKAGFVGMQGFGASAPAGELFEKFGIT HHCCCCCCCEEEEEEECCCCCCCEEEECCCCCCCCCCEEEECCCCCCCCHHHHHHHHCCC AEGTVAKVKELLG CCCHHHHHHHHHC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 8635754; 9256491 [H]