Definition Tropheryma whipplei TW08/27, complete genome.
Accession NC_004551
Length 925,938

Click here to switch to the map view.

The map label for this gene is Dxs

Identifier: 28572436

GI number: 28572436

Start: 313747

End: 315636

Strand: Direct

Name: Dxs

Synonym: TW280

Alternate gene names: 28572436

Gene position: 313747-315636 (Clockwise)

Preceding gene: 28572435

Following gene: 28572437

Centisome position: 33.88

GC content: 48.84

Gene sequence:

>1890_bases
ATGTGTACAAAACGGCAGTATGGTCTACTTGAAAGTATACGAAGCCCAAGAGACCTTGACTCTTTTACCCCGCATCAGCT
TGATGAGCTTGAGTGTCAGGTGCGCGATTTTCTCATCCAAAGTGTCGCAAAAACCGGTGGGCATCTGGGGTCGAATCTTG
GCGTTGTCGAGCTGAGCATAGCGCTACACAGGTCATTTAGATCTCCCGAAGACTGCATAATCTTTGATGTCGGTCATCAG
TGCTATGTTCACAAGCTAATAACCGGCAGGCACGATTTCAAAGCTTTACGGTGCAAGAATGGGCTATCCGGTTATCCGTC
ACGACATGAATCAAACCACGATATTGTCGAAAACTCTCATGCTTCCGCTGCACTTAGCTGGGCGGATGGCGTGTCACGTG
CTCGGACTCTGTTAGGTAATGACAATTATGTTATTGCTGTTGTCGGCGATGGGTCACTGACAGGCGGGATGTGCTGGGAG
GCGCTAAATAACATCAGCGACGACAATAACCGCCGGCTTGTAATAGTTGTCAACGATAATGGACGGTCGTATGCTCGTAC
AATTGGCGGTATAGCACGATTTTTGAATGCGGTTCGTGCAAGTAAGAGTTATTTGTGGCTCAGGGAGTCAAGCGAAGCGG
TGTTTTCGCATATGGGGTCACCCGGGCGGCGCCTGTACCAGGGGATTAGAGGGGCAATACATGGGTTCTTGAGCCGCTTT
TCAAGCTCAAATAAGCTTTTCTCGAATCTTGATATCCGGTATTTAGGACCGATAAATGGCCATAATCGCAAAGCTCTTGA
GAAGGCATTCAAACAGGCGAAGCAATATGCACGCCCAATTATTGTTCACGTGATAACAGAAAAGGGTCATGGATATCCCC
CAGCGCTCGAGGATGCTCTGGATTGTCTTCACACTGTTGGTGTAATAGATCCCAGCACTGGTAAATCCGCCTCTGTGCAG
GGCCAAGTGCGTCAAGATACATGGACTGGCGTCTTTGGGGAAGAGCTTTTGCGGCTTGCCGAGAGCAATACAAACATTGT
TGCTGTCACCGCTGCCATGCTACACCCAACTGGCCTTTCCATGTTTGCTGAAAAATTTCCACACAGGGTTTTCGATGTTG
GTATTGCGGAGCAGCATGCCGTTGCATCTGCCGCTGGGCTTGCGTATGAAGGGCTACATCCGGTTGTTGCGATTTATTCA
ACCTTTATGAATAGGGCCTTTGATCAGGTTATGATGGATGTTGCCTTACATGGCGCACCGGTAACGTTCGTCCTTGATAG
GGCAGGGATAACAGGTCCTGATGGGGCTAGCCACCACGGAATTTGGGACCTTTCGCTTTTGCGAATTGTGCCAGGTATTA
AACTTTATGCTCCACGGGATGCTAGCACATTGAGAAATACCCTCGCGCTTGTCTGCTCCGAAGATTGTCCTACTGCTATA
CGTTTCCCAAGAGGGAGTGTTTGCGACGATCTTCCGGCTTTACGTTCTCTGGACGACGGAATTGATGTGCTCTATGGATC
TTGCGATCGCGAAGATATCGTTATTGTTGCCATTGGCGTTATGGCACATGCATGCGTTAGAGCTGCCCAATTACTGGCAG
AGTCTGGAATAGAATCAACTGTTATAAATCCTGTTTGCTTCTGGCCCCTACATAGGCAGGTCCTGGCCAGGGTGTCGAAG
GCAAAGCTGGTTGTGCTTGCTGAAGAAGGGGCGAAATCACCCGGTCTTGGTGACTATATTGCCGGAAGACGATTGTTAGA
ATTTGTGATCCCAGGGGATTTCCAACCCCAGGGATCACGCGATGAGTTACTTGATGCAATTGGTTTAAATGGGGAGCATA
TTGCCCGTAAGATAAAGGCCCGGTTCAATCAAATTATCAATTGCGTGTAA

Upstream 100 bases:

>100_bases
TTACCCTCTTCTTGGGCTTACCGTGTTTACCTCATGGGTTTTGTTTAGAAAAATTAACTCGAAGAGTAAGTAGACTGGTG
GTGTTTTTCACGGATTTTTT

Downstream 100 bases:

>100_bases
GGCACCACGCTTTAAGACACCATGCTTGTGTTATGCCCTTTTGAGCCATGAAACATCGTTATTCACCGTCTCTTTTTCAC
TGTCTCTTTTGTAGAAAAAT

Product: 1-deoxy-D-xylulose-5-phosphate synthase

Products: NA

Alternate protein names: 1-deoxyxylulose-5-phosphate synthase; DXP synthase; DXPS

Number of amino acids: Translated: 629; Mature: 629

Protein sequence:

>629_residues
MCTKRQYGLLESIRSPRDLDSFTPHQLDELECQVRDFLIQSVAKTGGHLGSNLGVVELSIALHRSFRSPEDCIIFDVGHQ
CYVHKLITGRHDFKALRCKNGLSGYPSRHESNHDIVENSHASAALSWADGVSRARTLLGNDNYVIAVVGDGSLTGGMCWE
ALNNISDDNNRRLVIVVNDNGRSYARTIGGIARFLNAVRASKSYLWLRESSEAVFSHMGSPGRRLYQGIRGAIHGFLSRF
SSSNKLFSNLDIRYLGPINGHNRKALEKAFKQAKQYARPIIVHVITEKGHGYPPALEDALDCLHTVGVIDPSTGKSASVQ
GQVRQDTWTGVFGEELLRLAESNTNIVAVTAAMLHPTGLSMFAEKFPHRVFDVGIAEQHAVASAAGLAYEGLHPVVAIYS
TFMNRAFDQVMMDVALHGAPVTFVLDRAGITGPDGASHHGIWDLSLLRIVPGIKLYAPRDASTLRNTLALVCSEDCPTAI
RFPRGSVCDDLPALRSLDDGIDVLYGSCDREDIVIVAIGVMAHACVRAAQLLAESGIESTVINPVCFWPLHRQVLARVSK
AKLVVLAEEGAKSPGLGDYIAGRRLLEFVIPGDFQPQGSRDELLDAIGLNGEHIARKIKARFNQIINCV

Sequences:

>Translated_629_residues
MCTKRQYGLLESIRSPRDLDSFTPHQLDELECQVRDFLIQSVAKTGGHLGSNLGVVELSIALHRSFRSPEDCIIFDVGHQ
CYVHKLITGRHDFKALRCKNGLSGYPSRHESNHDIVENSHASAALSWADGVSRARTLLGNDNYVIAVVGDGSLTGGMCWE
ALNNISDDNNRRLVIVVNDNGRSYARTIGGIARFLNAVRASKSYLWLRESSEAVFSHMGSPGRRLYQGIRGAIHGFLSRF
SSSNKLFSNLDIRYLGPINGHNRKALEKAFKQAKQYARPIIVHVITEKGHGYPPALEDALDCLHTVGVIDPSTGKSASVQ
GQVRQDTWTGVFGEELLRLAESNTNIVAVTAAMLHPTGLSMFAEKFPHRVFDVGIAEQHAVASAAGLAYEGLHPVVAIYS
TFMNRAFDQVMMDVALHGAPVTFVLDRAGITGPDGASHHGIWDLSLLRIVPGIKLYAPRDASTLRNTLALVCSEDCPTAI
RFPRGSVCDDLPALRSLDDGIDVLYGSCDREDIVIVAIGVMAHACVRAAQLLAESGIESTVINPVCFWPLHRQVLARVSK
AKLVVLAEEGAKSPGLGDYIAGRRLLEFVIPGDFQPQGSRDELLDAIGLNGEHIARKIKARFNQIINCV
>Mature_629_residues
MCTKRQYGLLESIRSPRDLDSFTPHQLDELECQVRDFLIQSVAKTGGHLGSNLGVVELSIALHRSFRSPEDCIIFDVGHQ
CYVHKLITGRHDFKALRCKNGLSGYPSRHESNHDIVENSHASAALSWADGVSRARTLLGNDNYVIAVVGDGSLTGGMCWE
ALNNISDDNNRRLVIVVNDNGRSYARTIGGIARFLNAVRASKSYLWLRESSEAVFSHMGSPGRRLYQGIRGAIHGFLSRF
SSSNKLFSNLDIRYLGPINGHNRKALEKAFKQAKQYARPIIVHVITEKGHGYPPALEDALDCLHTVGVIDPSTGKSASVQ
GQVRQDTWTGVFGEELLRLAESNTNIVAVTAAMLHPTGLSMFAEKFPHRVFDVGIAEQHAVASAAGLAYEGLHPVVAIYS
TFMNRAFDQVMMDVALHGAPVTFVLDRAGITGPDGASHHGIWDLSLLRIVPGIKLYAPRDASTLRNTLALVCSEDCPTAI
RFPRGSVCDDLPALRSLDDGIDVLYGSCDREDIVIVAIGVMAHACVRAAQLLAESGIESTVINPVCFWPLHRQVLARVSK
AKLVVLAEEGAKSPGLGDYIAGRRLLEFVIPGDFQPQGSRDELLDAIGLNGEHIARKIKARFNQIINCV

Specific function: Catalyzes the acyloin condensation reaction between C atoms 2 and 3 of pyruvate and glyceraldehyde 3-phosphate to yield 1-deoxy-D-xylulose-5-phosphate (DXP)

COG id: COG1154

COG function: function code HI; Deoxyxylulose-5-phosphate synthase

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the transketolase family. DXPS subfamily

Homologues:

Organism=Homo sapiens, GI205277463, Length=411, Percent_Identity=23.6009732360097, Blast_Score=87, Evalue=5e-17,
Organism=Homo sapiens, GI4507521, Length=411, Percent_Identity=23.6009732360097, Blast_Score=87, Evalue=5e-17,
Organism=Homo sapiens, GI225637463, Length=411, Percent_Identity=22.3844282238443, Blast_Score=84, Evalue=5e-16,
Organism=Homo sapiens, GI225637459, Length=411, Percent_Identity=22.3844282238443, Blast_Score=84, Evalue=6e-16,
Organism=Homo sapiens, GI225637461, Length=411, Percent_Identity=22.3844282238443, Blast_Score=83, Evalue=7e-16,
Organism=Homo sapiens, GI133778974, Length=405, Percent_Identity=24.6913580246914, Blast_Score=82, Evalue=1e-15,
Organism=Escherichia coli, GI1786622, Length=626, Percent_Identity=34.9840255591054, Blast_Score=355, Evalue=5e-99,
Organism=Caenorhabditis elegans, GI17539652, Length=619, Percent_Identity=22.1324717285945, Blast_Score=90, Evalue=4e-18,
Organism=Drosophila melanogaster, GI24645119, Length=299, Percent_Identity=25.752508361204, Blast_Score=95, Evalue=1e-19,
Organism=Drosophila melanogaster, GI45551847, Length=299, Percent_Identity=25.752508361204, Blast_Score=95, Evalue=1e-19,
Organism=Drosophila melanogaster, GI45550715, Length=299, Percent_Identity=25.752508361204, Blast_Score=95, Evalue=1e-19,
Organism=Drosophila melanogaster, GI24666278, Length=261, Percent_Identity=26.4367816091954, Blast_Score=85, Evalue=1e-16,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): DXS_TROW8 (Q83I20)

Other databases:

- EMBL:   BX251410
- RefSeq:   NP_789216.1
- ProteinModelPortal:   Q83I20
- SMR:   Q83I20
- STRING:   Q83I20
- GeneID:   1064569
- GenomeReviews:   BX072543_GR
- KEGG:   tws:TW280
- eggNOG:   COG1154
- HOGENOM:   HBG571647
- OMA:   RESILRY
- ProtClustDB:   PRK05444
- BioCyc:   TWHI218496:TW0261-MONOMER
- HAMAP:   MF_00315
- InterPro:   IPR005477
- InterPro:   IPR009014
- InterPro:   IPR015941
- InterPro:   IPR005475
- InterPro:   IPR020826
- InterPro:   IPR005476
- InterPro:   IPR005474
- Gene3D:   G3DSA:3.40.50.920
- SMART:   SM00861
- TIGRFAMs:   TIGR00204

Pfam domain/function: PF02779 Transket_pyr; PF02780 Transketolase_C; SSF52922 Transketo_C_like

EC number: =2.2.1.7

Molecular weight: Translated: 68650; Mature: 68650

Theoretical pI: Translated: 7.49; Mature: 7.49

Prosite motif: PS00801 TRANSKETOLASE_1; PS00802 TRANSKETOLASE_2

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

2.2 %Cys     (Translated Protein)
1.4 %Met     (Translated Protein)
3.7 %Cys+Met (Translated Protein)
2.2 %Cys     (Mature Protein)
1.4 %Met     (Mature Protein)
3.7 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MCTKRQYGLLESIRSPRDLDSFTPHQLDELECQVRDFLIQSVAKTGGHLGSNLGVVELSI
CCCCHHHHHHHHHCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCEEEHH
ALHRSFRSPEDCIIFDVGHQCYVHKLITGRHDFKALRCKNGLSGYPSRHESNHDIVENSH
HHHHCCCCCCCEEEEECCCHHHHHHHHCCCCHHHHHHHCCCCCCCCCCCCCCCCHHCCCC
ASAALSWADGVSRARTLLGNDNYVIAVVGDGSLTGGMCWEALNNISDDNNRRLVIVVNDN
CHHHHHHHHHHHHHHHHCCCCCEEEEEEECCCCCHHHHHHHHHCCCCCCCCEEEEEECCC
GRSYARTIGGIARFLNAVRASKSYLWLRESSEAVFSHMGSPGRRLYQGIRGAIHGFLSRF
CCHHHHHHHHHHHHHHHHHCCCCEEEEECCHHHHHHHCCCCHHHHHHHHHHHHHHHHHHH
SSSNKLFSNLDIRYLGPINGHNRKALEKAFKQAKQYARPIIVHVITEKGHGYPPALEDAL
CCCCCHHHCCCEEEECCCCCCCHHHHHHHHHHHHHHCCCEEEEEEECCCCCCCCHHHHHH
DCLHTVGVIDPSTGKSASVQGQVRQDTWTGVFGEELLRLAESNTNIVAVTAAMLHPTGLS
HHHHHHCCCCCCCCCCCCCCCCCCCCHHCCHHHHHHHHHHCCCCCEEEEEEHHHCCCHHH
MFAEKFPHRVFDVGIAEQHAVASAAGLAYEGLHPVVAIYSTFMNRAFDQVMMDVALHGAP
HHHHHCCHHHHHCCCCHHHHHHHHHCCHHCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCC
VTFVLDRAGITGPDGASHHGIWDLSLLRIVPGIKLYAPRDASTLRNTLALVCSEDCPTAI
EEEEEECCCCCCCCCCCCCCCHHHHHHHHCCCCEEECCCCHHHHHHHHHHHCCCCCCCCE
RFPRGSVCDDLPALRSLDDGIDVLYGSCDREDIVIVAIGVMAHACVRAAQLLAESGIEST
ECCCCCCCCCCHHHHHCCCCHHHHCCCCCCCCEEEEEHHHHHHHHHHHHHHHHHCCCCHH
VINPVCFWPLHRQVLARVSKAKLVVLAEEGAKSPGLGDYIAGRRLLEFVIPGDFQPQGSR
HCCCHHHHHHHHHHHHHHHHCEEEEEECCCCCCCCCCHHHHHHHHHHHCCCCCCCCCCCH
DELLDAIGLNGEHIARKIKARFNQIINCV
HHHHHHHCCCHHHHHHHHHHHHHHHHCCC
>Mature Secondary Structure
MCTKRQYGLLESIRSPRDLDSFTPHQLDELECQVRDFLIQSVAKTGGHLGSNLGVVELSI
CCCCHHHHHHHHHCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCEEEHH
ALHRSFRSPEDCIIFDVGHQCYVHKLITGRHDFKALRCKNGLSGYPSRHESNHDIVENSH
HHHHCCCCCCCEEEEECCCHHHHHHHHCCCCHHHHHHHCCCCCCCCCCCCCCCCHHCCCC
ASAALSWADGVSRARTLLGNDNYVIAVVGDGSLTGGMCWEALNNISDDNNRRLVIVVNDN
CHHHHHHHHHHHHHHHHCCCCCEEEEEEECCCCCHHHHHHHHHCCCCCCCCEEEEEECCC
GRSYARTIGGIARFLNAVRASKSYLWLRESSEAVFSHMGSPGRRLYQGIRGAIHGFLSRF
CCHHHHHHHHHHHHHHHHHCCCCEEEEECCHHHHHHHCCCCHHHHHHHHHHHHHHHHHHH
SSSNKLFSNLDIRYLGPINGHNRKALEKAFKQAKQYARPIIVHVITEKGHGYPPALEDAL
CCCCCHHHCCCEEEECCCCCCCHHHHHHHHHHHHHHCCCEEEEEEECCCCCCCCHHHHHH
DCLHTVGVIDPSTGKSASVQGQVRQDTWTGVFGEELLRLAESNTNIVAVTAAMLHPTGLS
HHHHHHCCCCCCCCCCCCCCCCCCCCHHCCHHHHHHHHHHCCCCCEEEEEEHHHCCCHHH
MFAEKFPHRVFDVGIAEQHAVASAAGLAYEGLHPVVAIYSTFMNRAFDQVMMDVALHGAP
HHHHHCCHHHHHCCCCHHHHHHHHHCCHHCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCC
VTFVLDRAGITGPDGASHHGIWDLSLLRIVPGIKLYAPRDASTLRNTLALVCSEDCPTAI
EEEEEECCCCCCCCCCCCCCCHHHHHHHHCCCCEEECCCCHHHHHHHHHHHCCCCCCCCE
RFPRGSVCDDLPALRSLDDGIDVLYGSCDREDIVIVAIGVMAHACVRAAQLLAESGIEST
ECCCCCCCCCCHHHHHCCCCHHHHCCCCCCCCEEEEEHHHHHHHHHHHHHHHHHCCCCHH
VINPVCFWPLHRQVLARVSKAKLVVLAEEGAKSPGLGDYIAGRRLLEFVIPGDFQPQGSR
HCCCHHHHHHHHHHHHHHHHCEEEEEECCCCCCCCCCHHHHHHHHHHHCCCCCCCCCCCH
DELLDAIGLNGEHIARKIKARFNQIINCV
HHHHHHHCCCHHHHHHHHHHHHHHHHCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 12606174