Definition Francisella tularensis subsp. tularensis WY96-3418, complete genome.
Accession NC_009257
Length 1,898,476

Click here to switch to the map view.

The map label for this gene is dxs

Identifier: 134301918

GI number: 134301918

Start: 888315

End: 890162

Strand: Reverse

Name: dxs

Synonym: FTW_0925

Alternate gene names: 134301918

Gene position: 890162-888315 (Counterclockwise)

Preceding gene: 134301919

Following gene: 134301917

Centisome position: 46.89

GC content: 35.01

Gene sequence:

>1848_bases
ATGTCAAAATATACTATTTTAGATAAAATAAATACCCCATCTGATCTTAAGCTAATTCCTGAGAGTCAGCTCAAAATCTT
ATCAGCAGAGTTAAGAGCTTTCTTAGTAGATACTTTAGATGTAAGCGGTGGGCATTTTGCAAGTAGTCTTGGAGCTACAG
AGTTAACAGTTGCTTTGCATTATGTTTATAATGCGCCATATGATAATATCGTGTGGGATGTAGGGCATCAGACATATATT
CATAAGATTCTTACTGGCAGAAAAGATAAACTTGTCACCATTAAAAAAGATGGCGGTATTTCAGGCTTTCCTAAACGCAG
TGAGAGTGAATATGACACCTTTGGAGTCGGCCACTCAAGTACTTCTATAAGCGCTGCTTTAGGTATGGCTATAGCAGACA
GGCTACAAGGCAAATCTTCTAATACTGTAGCTGTAATTGGAGATGGCGCTATAACTGGTGGTATGGCTTTTGAAGCCTTA
AATCATGCTGGCGGTATCAAAGAAGATATTCTTGTTATACTCAATGATAATGAAATGTCTATTTCTGATAATGTTGGCGG
ACTTTCAGCACATTTTAGTAAAATTATTTCCGGTGGTTTTTATAATTCTATACGTGAGAAAGGTAAGGAAGTATTGAAAA
ATATTCCACCAATATTTGAGTTTGTCAAAAAGGTTGAAACTCAAACCAAGGGGATGTTTGTACCAGCAAATTTCTTTGAA
GATTTAGGCTTTTATTATGTTGGGCCTATCGATGGTCATGATGTTACAGAATTAGTTAAAACCCTAAGAATTCTAAAAGA
TCATAAGGGTCCAAAACTTTTACACGTAATTACTAAAAAAGGTAAAGGTTATACAAAAGCTGAATCAGATCCAATTAAAT
TTCATCATGTTGCACCAAGTTTTCATAGTGGCGAGAATATAACTACCAAGATTTCTAAACCAACTTATTCAAATATATTT
GGCGATTGGATTTGTCAAAAAGCTGCTAAAGATAAGCGTTTAGTTGGAATCACGCCAGCGATGAAAGAGGGTTCTGACTT
AATTAGGTTTTCACAACTATATCCGCATAGATATTTTGATGTAGCGATTGCTGAGCAACATGCAGTAACTTTTGCTGGTG
GCTTAGCTTGCCAAGGATTAAAGCCAGTCGTGGCAATATATTCAACATTCCTACAGCGAGCTTATGATCAAGTAATACAT
GATATAGCTTTACAAAATTTAGATGTACTATATGCTGTAGATAGAGCAGGTCTAGTTGGTGCTGATGGCGCAACTCATGA
TGGTAGCTTTGATTTAGCATTTATGCGCTGTATTCCTAACCATGTGATTATGACTCCAAGTGATGAAAATGAAGCTTATC
ATATGCTAGAGTTTGGCTATGAGTATAATGGTCCAGCAATGGTACGTTATCCACGTGGTGCTGGTATTGGCGCTGAAATT
ACTGGTAGTTTAGATCTAGAATTAGGTAAAGCAAAAATTGTTAAACAAGGTTCAAAAATTGCAATTTTAAATTTTGGAAC
TTTATTGCCTCTAGCCAAACAGCTAGCTGAGAAGTATCATGCTACAGTTATAGATATGCGTTTTGTCAAACCACTTGATG
AAATTATGCTTGATAAAGTATCTCAAACTCACGAGATAATATTAACTTTAGAAGAGAATTGTATAGCTGGGGGCGCAGGT
TCTGCTGTTAATGAATATTTTGTAGCTAAAGATCTTAGCAATAAAATAATAGTTAGAAATTTTGGACTTCAAGATAAATT
TCTCAATCATGGTACAAAAGATTTATTATTAGCTCAAAGTAAGCTTTGTGTTGAAAATATATCTCAAGAGTTAGATAAAC
TAATTTAA

Upstream 100 bases:

>100_bases
AACAATTGAATGGGAATAACGCATCTCTGTGTTATAACATAAATGTTTAATTATAAAAGTATTTTTTATTTACTTTTAAG
TTAGATGAAGATTTTAAGCT

Downstream 100 bases:

>100_bases
TAGGATGCTTATTTTATGGAATTATTATTTTCATATGGAACCTTACAGCAAGAAGAGGTACAACTTTCAGTCTTTGGCAG
AAAACTCGTAGGACAAAAAG

Product: 1-deoxy-D-xylulose-5-phosphate synthase

Products: NA

Alternate protein names: 1-deoxyxylulose-5-phosphate synthase; DXP synthase; DXPS

Number of amino acids: Translated: 615; Mature: 614

Protein sequence:

>615_residues
MSKYTILDKINTPSDLKLIPESQLKILSAELRAFLVDTLDVSGGHFASSLGATELTVALHYVYNAPYDNIVWDVGHQTYI
HKILTGRKDKLVTIKKDGGISGFPKRSESEYDTFGVGHSSTSISAALGMAIADRLQGKSSNTVAVIGDGAITGGMAFEAL
NHAGGIKEDILVILNDNEMSISDNVGGLSAHFSKIISGGFYNSIREKGKEVLKNIPPIFEFVKKVETQTKGMFVPANFFE
DLGFYYVGPIDGHDVTELVKTLRILKDHKGPKLLHVITKKGKGYTKAESDPIKFHHVAPSFHSGENITTKISKPTYSNIF
GDWICQKAAKDKRLVGITPAMKEGSDLIRFSQLYPHRYFDVAIAEQHAVTFAGGLACQGLKPVVAIYSTFLQRAYDQVIH
DIALQNLDVLYAVDRAGLVGADGATHDGSFDLAFMRCIPNHVIMTPSDENEAYHMLEFGYEYNGPAMVRYPRGAGIGAEI
TGSLDLELGKAKIVKQGSKIAILNFGTLLPLAKQLAEKYHATVIDMRFVKPLDEIMLDKVSQTHEIILTLEENCIAGGAG
SAVNEYFVAKDLSNKIIVRNFGLQDKFLNHGTKDLLLAQSKLCVENISQELDKLI

Sequences:

>Translated_615_residues
MSKYTILDKINTPSDLKLIPESQLKILSAELRAFLVDTLDVSGGHFASSLGATELTVALHYVYNAPYDNIVWDVGHQTYI
HKILTGRKDKLVTIKKDGGISGFPKRSESEYDTFGVGHSSTSISAALGMAIADRLQGKSSNTVAVIGDGAITGGMAFEAL
NHAGGIKEDILVILNDNEMSISDNVGGLSAHFSKIISGGFYNSIREKGKEVLKNIPPIFEFVKKVETQTKGMFVPANFFE
DLGFYYVGPIDGHDVTELVKTLRILKDHKGPKLLHVITKKGKGYTKAESDPIKFHHVAPSFHSGENITTKISKPTYSNIF
GDWICQKAAKDKRLVGITPAMKEGSDLIRFSQLYPHRYFDVAIAEQHAVTFAGGLACQGLKPVVAIYSTFLQRAYDQVIH
DIALQNLDVLYAVDRAGLVGADGATHDGSFDLAFMRCIPNHVIMTPSDENEAYHMLEFGYEYNGPAMVRYPRGAGIGAEI
TGSLDLELGKAKIVKQGSKIAILNFGTLLPLAKQLAEKYHATVIDMRFVKPLDEIMLDKVSQTHEIILTLEENCIAGGAG
SAVNEYFVAKDLSNKIIVRNFGLQDKFLNHGTKDLLLAQSKLCVENISQELDKLI
>Mature_614_residues
SKYTILDKINTPSDLKLIPESQLKILSAELRAFLVDTLDVSGGHFASSLGATELTVALHYVYNAPYDNIVWDVGHQTYIH
KILTGRKDKLVTIKKDGGISGFPKRSESEYDTFGVGHSSTSISAALGMAIADRLQGKSSNTVAVIGDGAITGGMAFEALN
HAGGIKEDILVILNDNEMSISDNVGGLSAHFSKIISGGFYNSIREKGKEVLKNIPPIFEFVKKVETQTKGMFVPANFFED
LGFYYVGPIDGHDVTELVKTLRILKDHKGPKLLHVITKKGKGYTKAESDPIKFHHVAPSFHSGENITTKISKPTYSNIFG
DWICQKAAKDKRLVGITPAMKEGSDLIRFSQLYPHRYFDVAIAEQHAVTFAGGLACQGLKPVVAIYSTFLQRAYDQVIHD
IALQNLDVLYAVDRAGLVGADGATHDGSFDLAFMRCIPNHVIMTPSDENEAYHMLEFGYEYNGPAMVRYPRGAGIGAEIT
GSLDLELGKAKIVKQGSKIAILNFGTLLPLAKQLAEKYHATVIDMRFVKPLDEIMLDKVSQTHEIILTLEENCIAGGAGS
AVNEYFVAKDLSNKIIVRNFGLQDKFLNHGTKDLLLAQSKLCVENISQELDKLI

Specific function: Catalyzes the acyloin condensation reaction between C atoms 2 and 3 of pyruvate and glyceraldehyde 3-phosphate to yield 1-deoxy-D-xylulose-5-phosphate (DXP)

COG id: COG1154

COG function: function code HI; Deoxyxylulose-5-phosphate synthase

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the transketolase family. DXPS subfamily

Homologues:

Organism=Homo sapiens, GI205277463, Length=631, Percent_Identity=22.9793977812995, Blast_Score=91, Evalue=3e-18,
Organism=Homo sapiens, GI4507521, Length=631, Percent_Identity=22.9793977812995, Blast_Score=91, Evalue=3e-18,
Organism=Homo sapiens, GI225637459, Length=225, Percent_Identity=28.8888888888889, Blast_Score=78, Evalue=3e-14,
Organism=Homo sapiens, GI225637463, Length=225, Percent_Identity=28.8888888888889, Blast_Score=78, Evalue=3e-14,
Organism=Homo sapiens, GI225637461, Length=225, Percent_Identity=28.8888888888889, Blast_Score=77, Evalue=4e-14,
Organism=Escherichia coli, GI1786622, Length=602, Percent_Identity=57.4750830564784, Blast_Score=733, Evalue=0.0,
Organism=Caenorhabditis elegans, GI17539652, Length=379, Percent_Identity=25.8575197889182, Blast_Score=88, Evalue=1e-17,
Organism=Drosophila melanogaster, GI24645119, Length=496, Percent_Identity=26.6129032258064, Blast_Score=107, Evalue=2e-23,
Organism=Drosophila melanogaster, GI45551847, Length=492, Percent_Identity=26.6260162601626, Blast_Score=107, Evalue=2e-23,
Organism=Drosophila melanogaster, GI45550715, Length=492, Percent_Identity=26.6260162601626, Blast_Score=107, Evalue=2e-23,
Organism=Drosophila melanogaster, GI24666278, Length=492, Percent_Identity=24.1869918699187, Blast_Score=89, Evalue=8e-18,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): DXS_FRAT1 (Q14HJ1)

Other databases:

- EMBL:   AM286280
- RefSeq:   YP_667135.1
- ProteinModelPortal:   Q14HJ1
- SMR:   Q14HJ1
- STRING:   Q14HJ1
- GeneID:   4199668
- GenomeReviews:   AM286280_GR
- KEGG:   ftf:FTF1018c
- eggNOG:   COG1154
- HOGENOM:   HBG571647
- OMA:   QRFPDRY
- PhylomeDB:   Q14HJ1
- ProtClustDB:   PRK05444
- BioCyc:   FTUL393115:FTF1018C-MONOMER
- HAMAP:   MF_00315
- InterPro:   IPR001017
- InterPro:   IPR005477
- InterPro:   IPR009014
- InterPro:   IPR015941
- InterPro:   IPR005475
- InterPro:   IPR020826
- InterPro:   IPR005476
- InterPro:   IPR005474
- Gene3D:   G3DSA:3.40.50.920
- SMART:   SM00861
- TIGRFAMs:   TIGR00204

Pfam domain/function: PF00676 E1_dh; PF02779 Transket_pyr; PF02780 Transketolase_C; SSF52922 Transketo_C_like

EC number: =2.2.1.7

Molecular weight: Translated: 67343; Mature: 67212

Theoretical pI: Translated: 6.92; Mature: 6.92

Prosite motif: PS00801 TRANSKETOLASE_1; PS00802 TRANSKETOLASE_2

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.8 %Cys     (Translated Protein)
2.0 %Met     (Translated Protein)
2.8 %Cys+Met (Translated Protein)
0.8 %Cys     (Mature Protein)
1.8 %Met     (Mature Protein)
2.6 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSKYTILDKINTPSDLKLIPESQLKILSAELRAFLVDTLDVSGGHFASSLGATELTVALH
CCCEEEEECCCCCCCCEECCHHHHHHHHHHHHHHHHHHEECCCCCHHHHCCCHHHEEEEE
YVYNAPYDNIVWDVGHQTYIHKILTGRKDKLVTIKKDGGISGFPKRSESEYDTFGVGHSS
EEECCCCCCCEEECCCHHHHHHHHCCCCCCEEEEECCCCCCCCCCCCCCCCCCCCCCCCC
TSISAALGMAIADRLQGKSSNTVAVIGDGAITGGMAFEALNHAGGIKEDILVILNDNEMS
CHHHHHHHHHHHHHHCCCCCCEEEEEECCCCCCCHHHHHHHHCCCCCCCEEEEECCCCEE
ISDNVGGLSAHFSKIISGGFYNSIREKGKEVLKNIPPIFEFVKKVETQTKGMFVPANFFE
ECCCCCCHHHHHHHHHCCHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHCCEEEEHHHHH
DLGFYYVGPIDGHDVTELVKTLRILKDHKGPKLLHVITKKGKGYTKAESDPIKFHHVAPS
HCCCEEECCCCCCCHHHHHHHHHHHHCCCCCEEEEEEECCCCCCCCCCCCCEEEEEECCC
FHSGENITTKISKPTYSNIFGDWICQKAAKDKRLVGITPAMKEGSDLIRFSQLYPHRYFD
CCCCCCEEEEECCCCHHHHHHHHHHHHHCCCCEEEECCCCCCCCCHHHHHHHHCCCCEEE
VAIAEQHAVTFAGGLACQGLKPVVAIYSTFLQRAYDQVIHDIALQNLDVLYAVDRAGLVG
EEEECCCEEEEECCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHCCEEEEEECCCCEEE
ADGATHDGSFDLAFMRCIPNHVIMTPSDENEAYHMLEFGYEYNGPAMVRYPRGAGIGAEI
CCCCCCCCCCCCHHEECCCCCEEECCCCCCCCEEEEEECEEECCCEEEEECCCCCCCCEE
TGSLDLELGKAKIVKQGSKIAILNFGTLLPLAKQLAEKYHATVIDMRFVKPLDEIMLDKV
ECCEEEEECHHHHHCCCCEEEEEECCHHHHHHHHHHHHHHHHHEEHHHHHHHHHHHHHHH
SQTHEIILTLEENCIAGGAGSAVNEYFVAKDLSNKIIVRNFGLQDKFLNHGTKDLLLAQS
CCCEEEEEEEECCCCCCCCCCHHHHHHHHHCCCCEEEEEECCCCHHHHHCCCHHHHHHHH
KLCVENISQELDKLI
HHHHHHHHHHHHHCC
>Mature Secondary Structure 
SKYTILDKINTPSDLKLIPESQLKILSAELRAFLVDTLDVSGGHFASSLGATELTVALH
CCEEEEECCCCCCCCEECCHHHHHHHHHHHHHHHHHHEECCCCCHHHHCCCHHHEEEEE
YVYNAPYDNIVWDVGHQTYIHKILTGRKDKLVTIKKDGGISGFPKRSESEYDTFGVGHSS
EEECCCCCCCEEECCCHHHHHHHHCCCCCCEEEEECCCCCCCCCCCCCCCCCCCCCCCCC
TSISAALGMAIADRLQGKSSNTVAVIGDGAITGGMAFEALNHAGGIKEDILVILNDNEMS
CHHHHHHHHHHHHHHCCCCCCEEEEEECCCCCCCHHHHHHHHCCCCCCCEEEEECCCCEE
ISDNVGGLSAHFSKIISGGFYNSIREKGKEVLKNIPPIFEFVKKVETQTKGMFVPANFFE
ECCCCCCHHHHHHHHHCCHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHCCEEEEHHHHH
DLGFYYVGPIDGHDVTELVKTLRILKDHKGPKLLHVITKKGKGYTKAESDPIKFHHVAPS
HCCCEEECCCCCCCHHHHHHHHHHHHCCCCCEEEEEEECCCCCCCCCCCCCEEEEEECCC
FHSGENITTKISKPTYSNIFGDWICQKAAKDKRLVGITPAMKEGSDLIRFSQLYPHRYFD
CCCCCCEEEEECCCCHHHHHHHHHHHHHCCCCEEEECCCCCCCCCHHHHHHHHCCCCEEE
VAIAEQHAVTFAGGLACQGLKPVVAIYSTFLQRAYDQVIHDIALQNLDVLYAVDRAGLVG
EEEECCCEEEEECCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHCCEEEEEECCCCEEE
ADGATHDGSFDLAFMRCIPNHVIMTPSDENEAYHMLEFGYEYNGPAMVRYPRGAGIGAEI
CCCCCCCCCCCCHHEECCCCCEEECCCCCCCCEEEEEECEEECCCEEEEECCCCCCCCEE
TGSLDLELGKAKIVKQGSKIAILNFGTLLPLAKQLAEKYHATVIDMRFVKPLDEIMLDKV
ECCEEEEECHHHHHCCCCEEEEEECCHHHHHHHHHHHHHHHHHEEHHHHHHHHHHHHHHH
SQTHEIILTLEENCIAGGAGSAVNEYFVAKDLSNKIIVRNFGLQDKFLNHGTKDLLLAQS
CCCEEEEEEEECCCCCCCCCCHHHHHHHHHCCCCEEEEEECCCCHHHHHCCCHHHHHHHH
KLCVENISQELDKLI
HHHHHHHHHHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA