Definition Geobacter sulfurreducens PCA chromosome, complete genome.
Accession NC_002939
Length 3,814,139

Click here to switch to the map view.

The map label for this gene is dxs-1

Identifier: 39995792

GI number: 39995792

Start: 722405

End: 724318

Strand: Reverse

Name: dxs-1

Synonym: GSU0686

Alternate gene names: 39995792

Gene position: 724318-722405 (Counterclockwise)

Preceding gene: 39995793

Following gene: 39995791

Centisome position: 18.99

GC content: 66.14

Gene sequence:

>1914_bases
ATGTCCACGCTGCTCGACACAATCACCTGCCCCGCCGATCTGAAAAAGATCCCGCGGGACCAACTCCCGGCTCTGGCCGA
GGAGATCCGCGCGTTTCTTCTGGAAACCGTATCCCGCACCGGTGGCCATCTGGCCTCGAACCTGGGGGTGGTCGAACTCT
CCATTGCCCTCCACTACTGTTTCGACTCGCCAACGGACCGGTTCGTCTGGGACGTGGGACACCAGGCCTACACCCACAAG
ATTCTCACCGGCCGCCGCGACCGCTTCCACACCCAGCGCCAGTACGGCGGCATCAGCGGCTTCCCCAAGCGGAGCGAATC
GTCCCACGATGCTTTTGACACCGGGCACTCCTCCACTTCCATCTCGGCTGGGCTCGGCATGGCCATGGCCCGGGAGTTGA
GGGGGGGGAGCAACAAGGTGGTCGCCGTCATCGGCGACGGCTCCATGACCGGCGGCATCGCCTTCGAGGCCCTCAACCAG
GCGGGGCACCTGAAGAAAAACCTCATCGTCGTGCTCAACGACAACGAGATGTCCATCTCCCCCAACGTGGGGGCCTTTTC
CTCCTTTGTCTCCCGCAAGCTCACGGGCAGCTACTTCCGCGAGTTGAAGAAGGAGGTCCAGGGGCTGCTGCAGAACATCC
CGGCCATCGGCAAGGACATCCTCCAGTTCGCCCGCCGGGCCGAGAACTCCCTCAAGGGGTTCCTGACCCCGGGGATGCTC
TTCGAGGCCCTGGGCTTCGACTACATCGGCCCCATCCAGGGGCACAACCTGCCCCAGCTTCTGGAGGTGTTCGAGAATGC
CCGGGGATTGGATGGCCCGGTGGTGGTCCACGTCATGACCACCAAGGGCAAGGGGTACGTGCCGGCAGAGACGAACCCGT
CCGCATTCCACGGCGTCGGCCCCTTTGACGTGGCCACCGGCAAAACCACCGGCAGCAAGCCGGGGGCCGCCTCCTATACC
GGCATCTTCGGAGATACCCTGGCACAACTGGCCCGGGAAAACGAAAAAATCGTCGCCATCACCGCGGCCATGCCCGACGG
CACCGGTCTTACCGGCTTCGCGAAAGAGTTCCCCGAGCGCTTCTTCGACGTGGGGATCGCGGAGCAGCACGCCGTCACCT
TTGCGGCGGGGCTGGCGGCCGAAGGCTTCCGTCCCGTGACCGCCATCTACTCCACCTTCCTCCAACGGGCTTACGACCAG
GTGTTCCACGACGTCTGCCTCCAGAACCTGCCGGTCGTCTTCGCCCTGGACCGGGGGGGAGTCGTGGGCGACGACGGCCC
CACCCACCACGGGGTCTTCGACCTGTCGTACCTGCGGCACCTGCCCGGCATGACCCTGATGGCGCCCAAAGACGAGAACG
AACTGCGCCACATGCTCAAGACCGCCGTCTCCCATGATGGCCCCATCGCCCTGCGCTATCCCCGCGGTGCCGGCTGCGGC
ATCCCCCTGGACCAGGAGCTTCGGGAGATCCCCATCGGCACAGGTGAAATCCTGGCCGAAGGAGACGACGTCGCCATCAT
CGCCATCGGCATCACGGTCCTGCCCGCCCTTGAGGCTGCACGGACCCTGGCGGAGAAAGGAATCCGGGCCACGGTGATCA
ACGCCCGCTTCGTCAAGCCCCTGGACCGGGAGATGATCCTCCAGGCGGCCCGCCGGACCGGCTGCATAATCACCGCCGAG
GAAAACGCCCTGCAGGGAGGCTTCGGCAGCGCCGTACTCGAACTCCTCGCCGACGAGGGGATGACCGGCGTGCGGGTGAA
GCGGCTCGGCATCCCCGACCGGTTCGTGGAGCAGGGTCCCCAGCCGCAACTGCGGGCCGACCTGGGCATCGACGCCGCCG
GCATCGCTGCCGCGACCGAGGCGTTCCTGGCGGCAAAGGGGGCCCCGGCGCCCGCTCTCTCGATGGTCAAATGA

Upstream 100 bases:

>100_bases
CCTGCGCAGGGCCGTGGAGTGGTTCCGCGCCAACGGGTATGCCCGGTGAACTGAGGCCGAAGGCTAAGGATTCCCTTTGC
CCTCGGCCGGGAGGTTACGC

Downstream 100 bases:

>100_bases
TCCGGCACCTGGAGGGAAGGAGGGGCATTCCTCCTGCCCCGACCAAGACGAAACAGACATACATGTGAAAGGAATTGCCG
TTCAATGCGCTTTCCCTGGC

Product: 1-deoxy-D-xylulose-5-phosphate synthase

Products: NA

Alternate protein names: 1-deoxyxylulose-5-phosphate synthase 1; DXP synthase 1; DXPS 1

Number of amino acids: Translated: 637; Mature: 636

Protein sequence:

>637_residues
MSTLLDTITCPADLKKIPRDQLPALAEEIRAFLLETVSRTGGHLASNLGVVELSIALHYCFDSPTDRFVWDVGHQAYTHK
ILTGRRDRFHTQRQYGGISGFPKRSESSHDAFDTGHSSTSISAGLGMAMARELRGGSNKVVAVIGDGSMTGGIAFEALNQ
AGHLKKNLIVVLNDNEMSISPNVGAFSSFVSRKLTGSYFRELKKEVQGLLQNIPAIGKDILQFARRAENSLKGFLTPGML
FEALGFDYIGPIQGHNLPQLLEVFENARGLDGPVVVHVMTTKGKGYVPAETNPSAFHGVGPFDVATGKTTGSKPGAASYT
GIFGDTLAQLARENEKIVAITAAMPDGTGLTGFAKEFPERFFDVGIAEQHAVTFAAGLAAEGFRPVTAIYSTFLQRAYDQ
VFHDVCLQNLPVVFALDRGGVVGDDGPTHHGVFDLSYLRHLPGMTLMAPKDENELRHMLKTAVSHDGPIALRYPRGAGCG
IPLDQELREIPIGTGEILAEGDDVAIIAIGITVLPALEAARTLAEKGIRATVINARFVKPLDREMILQAARRTGCIITAE
ENALQGGFGSAVLELLADEGMTGVRVKRLGIPDRFVEQGPQPQLRADLGIDAAGIAAATEAFLAAKGAPAPALSMVK

Sequences:

>Translated_637_residues
MSTLLDTITCPADLKKIPRDQLPALAEEIRAFLLETVSRTGGHLASNLGVVELSIALHYCFDSPTDRFVWDVGHQAYTHK
ILTGRRDRFHTQRQYGGISGFPKRSESSHDAFDTGHSSTSISAGLGMAMARELRGGSNKVVAVIGDGSMTGGIAFEALNQ
AGHLKKNLIVVLNDNEMSISPNVGAFSSFVSRKLTGSYFRELKKEVQGLLQNIPAIGKDILQFARRAENSLKGFLTPGML
FEALGFDYIGPIQGHNLPQLLEVFENARGLDGPVVVHVMTTKGKGYVPAETNPSAFHGVGPFDVATGKTTGSKPGAASYT
GIFGDTLAQLARENEKIVAITAAMPDGTGLTGFAKEFPERFFDVGIAEQHAVTFAAGLAAEGFRPVTAIYSTFLQRAYDQ
VFHDVCLQNLPVVFALDRGGVVGDDGPTHHGVFDLSYLRHLPGMTLMAPKDENELRHMLKTAVSHDGPIALRYPRGAGCG
IPLDQELREIPIGTGEILAEGDDVAIIAIGITVLPALEAARTLAEKGIRATVINARFVKPLDREMILQAARRTGCIITAE
ENALQGGFGSAVLELLADEGMTGVRVKRLGIPDRFVEQGPQPQLRADLGIDAAGIAAATEAFLAAKGAPAPALSMVK
>Mature_636_residues
STLLDTITCPADLKKIPRDQLPALAEEIRAFLLETVSRTGGHLASNLGVVELSIALHYCFDSPTDRFVWDVGHQAYTHKI
LTGRRDRFHTQRQYGGISGFPKRSESSHDAFDTGHSSTSISAGLGMAMARELRGGSNKVVAVIGDGSMTGGIAFEALNQA
GHLKKNLIVVLNDNEMSISPNVGAFSSFVSRKLTGSYFRELKKEVQGLLQNIPAIGKDILQFARRAENSLKGFLTPGMLF
EALGFDYIGPIQGHNLPQLLEVFENARGLDGPVVVHVMTTKGKGYVPAETNPSAFHGVGPFDVATGKTTGSKPGAASYTG
IFGDTLAQLARENEKIVAITAAMPDGTGLTGFAKEFPERFFDVGIAEQHAVTFAAGLAAEGFRPVTAIYSTFLQRAYDQV
FHDVCLQNLPVVFALDRGGVVGDDGPTHHGVFDLSYLRHLPGMTLMAPKDENELRHMLKTAVSHDGPIALRYPRGAGCGI
PLDQELREIPIGTGEILAEGDDVAIIAIGITVLPALEAARTLAEKGIRATVINARFVKPLDREMILQAARRTGCIITAEE
NALQGGFGSAVLELLADEGMTGVRVKRLGIPDRFVEQGPQPQLRADLGIDAAGIAAATEAFLAAKGAPAPALSMVK

Specific function: Catalyzes the acyloin condensation reaction between C atoms 2 and 3 of pyruvate and glyceraldehyde 3-phosphate to yield 1-deoxy-D-xylulose-5-phosphate (DXP)

COG id: COG1154

COG function: function code HI; Deoxyxylulose-5-phosphate synthase

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the transketolase family. DXPS subfamily

Homologues:

Organism=Homo sapiens, GI205277463, Length=609, Percent_Identity=24.4663382594417, Blast_Score=129, Evalue=6e-30,
Organism=Homo sapiens, GI4507521, Length=609, Percent_Identity=24.4663382594417, Blast_Score=129, Evalue=6e-30,
Organism=Homo sapiens, GI225637463, Length=340, Percent_Identity=29.7058823529412, Blast_Score=113, Evalue=5e-25,
Organism=Homo sapiens, GI225637459, Length=340, Percent_Identity=29.7058823529412, Blast_Score=113, Evalue=6e-25,
Organism=Homo sapiens, GI225637461, Length=340, Percent_Identity=29.7058823529412, Blast_Score=113, Evalue=7e-25,
Organism=Homo sapiens, GI133778974, Length=612, Percent_Identity=25.4901960784314, Blast_Score=111, Evalue=2e-24,
Organism=Homo sapiens, GI156564403, Length=236, Percent_Identity=25.8474576271186, Blast_Score=84, Evalue=3e-16,
Organism=Homo sapiens, GI4557353, Length=235, Percent_Identity=25.9574468085106, Blast_Score=82, Evalue=1e-15,
Organism=Homo sapiens, GI34101272, Length=235, Percent_Identity=25.9574468085106, Blast_Score=82, Evalue=1e-15,
Organism=Homo sapiens, GI291084858, Length=228, Percent_Identity=24.5614035087719, Blast_Score=74, Evalue=3e-13,
Organism=Escherichia coli, GI1786622, Length=621, Percent_Identity=50.0805152979066, Blast_Score=626, Evalue=1e-180,
Organism=Caenorhabditis elegans, GI17539652, Length=665, Percent_Identity=25.1127819548872, Blast_Score=135, Evalue=5e-32,
Organism=Caenorhabditis elegans, GI17538422, Length=234, Percent_Identity=28.2051282051282, Blast_Score=80, Evalue=4e-15,
Organism=Saccharomyces cerevisiae, GI6319698, Length=229, Percent_Identity=28.3842794759825, Blast_Score=71, Evalue=5e-13,
Organism=Drosophila melanogaster, GI45551847, Length=636, Percent_Identity=25.7861635220126, Blast_Score=133, Evalue=5e-31,
Organism=Drosophila melanogaster, GI45550715, Length=636, Percent_Identity=25.7861635220126, Blast_Score=133, Evalue=5e-31,
Organism=Drosophila melanogaster, GI24645119, Length=596, Percent_Identity=25.8389261744966, Blast_Score=132, Evalue=8e-31,
Organism=Drosophila melanogaster, GI24666278, Length=598, Percent_Identity=27.0903010033445, Blast_Score=130, Evalue=4e-30,
Organism=Drosophila melanogaster, GI21358145, Length=243, Percent_Identity=27.5720164609054, Blast_Score=93, Evalue=7e-19,
Organism=Drosophila melanogaster, GI24650940, Length=243, Percent_Identity=27.5720164609054, Blast_Score=93, Evalue=7e-19,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): DXS1_GEOSL (Q74FC3)

Other databases:

- EMBL:   AE017180
- RefSeq:   NP_951743.1
- ProteinModelPortal:   Q74FC3
- SMR:   Q74FC3
- GeneID:   2685342
- GenomeReviews:   AE017180_GR
- KEGG:   gsu:GSU0686
- NMPDR:   fig|243231.1.peg.681
- TIGR:   GSU0686
- HOGENOM:   HBG571647
- OMA:   QRFPDRY
- ProtClustDB:   PRK05444
- BioCyc:   GSUL243231:GSU_0686-MONOMER
- BRENDA:   2.2.1.7
- HAMAP:   MF_00315
- InterPro:   IPR005477
- InterPro:   IPR009014
- InterPro:   IPR015941
- InterPro:   IPR005475
- InterPro:   IPR020826
- InterPro:   IPR005476
- InterPro:   IPR005474
- Gene3D:   G3DSA:3.40.50.920
- SMART:   SM00861
- TIGRFAMs:   TIGR00204

Pfam domain/function: PF02779 Transket_pyr; PF02780 Transketolase_C; PF00456 Transketolase_N; SSF52922 Transketo_C_like

EC number: =2.2.1.7

Molecular weight: Translated: 68014; Mature: 67882

Theoretical pI: Translated: 6.52; Mature: 6.52

Prosite motif: PS00801 TRANSKETOLASE_1; PS00802 TRANSKETOLASE_2

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.8 %Cys     (Translated Protein)
2.2 %Met     (Translated Protein)
3.0 %Cys+Met (Translated Protein)
0.8 %Cys     (Mature Protein)
2.0 %Met     (Mature Protein)
2.8 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSTLLDTITCPADLKKIPRDQLPALAEEIRAFLLETVSRTGGHLASNLGVVELSIALHYC
CCCHHHHHCCCHHHHHCCHHHHHHHHHHHHHHHHHHHHHCCCHHHHCCCEEEEEEEHEEC
FDSPTDRFVWDVGHQAYTHKILTGRRDRFHTQRQYGGISGFPKRSESSHDAFDTGHSSTS
CCCCCCCCEECCCCHHHHHHHHCCCHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCC
ISAGLGMAMARELRGGSNKVVAVIGDGSMTGGIAFEALNQAGHLKKNLIVVLNDNEMSIS
HHHHHHHHHHHHHCCCCCCEEEEEECCCCCCCHHHHHHHHCCCCCCCEEEEECCCCEEEC
PNVGAFSSFVSRKLTGSYFRELKKEVQGLLQNIPAIGKDILQFARRAENSLKGFLTPGML
CCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHCCCHHHH
FEALGFDYIGPIQGHNLPQLLEVFENARGLDGPVVVHVMTTKGKGYVPAETNPSAFHGVG
HHHHCCCCCCCCCCCCHHHHHHHHHHCCCCCCCEEEEEEEECCCEECCCCCCCCCCCCCC
PFDVATGKTTGSKPGAASYTGIFGDTLAQLARENEKIVAITAAMPDGTGLTGFAKEFPER
CCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHCCCCEEEEEEECCCCCCCCHHHHHHHHH
FFDVGIAEQHAVTFAAGLAAEGFRPVTAIYSTFLQRAYDQVFHDVCLQNLPVVFALDRGG
HHHCCCCHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCEEEEECCCC
VVGDDGPTHHGVFDLSYLRHLPGMTLMAPKDENELRHMLKTAVSHDGPIALRYPRGAGCG
CCCCCCCCCCCEEEHHHHHHCCCCEEECCCCHHHHHHHHHHHHCCCCCEEEECCCCCCCC
IPLDQELREIPIGTGEILAEGDDVAIIAIGITVLPALEAARTLAEKGIRATVINARFVKP
CCCHHHHHHCCCCCCCEEECCCCEEEEEEHHHHHHHHHHHHHHHHCCCEEEEECHHHCCC
LDREMILQAARRTGCIITAEENALQGGFGSAVLELLADEGMTGVRVKRLGIPDRFVEQGP
CCHHHHHHHHHHCCEEEEECCCCCCCCHHHHHHHHHHHCCCCCEEEEECCCCHHHHHCCC
QPQLRADLGIDAAGIAAATEAFLAAKGAPAPALSMVK
CCCHHHCCCCCHHHHHHHHHHHHHCCCCCCCCCCCCC
>Mature Secondary Structure 
STLLDTITCPADLKKIPRDQLPALAEEIRAFLLETVSRTGGHLASNLGVVELSIALHYC
CCHHHHHCCCHHHHHCCHHHHHHHHHHHHHHHHHHHHHCCCHHHHCCCEEEEEEEHEEC
FDSPTDRFVWDVGHQAYTHKILTGRRDRFHTQRQYGGISGFPKRSESSHDAFDTGHSSTS
CCCCCCCCEECCCCHHHHHHHHCCCHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCC
ISAGLGMAMARELRGGSNKVVAVIGDGSMTGGIAFEALNQAGHLKKNLIVVLNDNEMSIS
HHHHHHHHHHHHHCCCCCCEEEEEECCCCCCCHHHHHHHHCCCCCCCEEEEECCCCEEEC
PNVGAFSSFVSRKLTGSYFRELKKEVQGLLQNIPAIGKDILQFARRAENSLKGFLTPGML
CCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHCCCHHHH
FEALGFDYIGPIQGHNLPQLLEVFENARGLDGPVVVHVMTTKGKGYVPAETNPSAFHGVG
HHHHCCCCCCCCCCCCHHHHHHHHHHCCCCCCCEEEEEEEECCCEECCCCCCCCCCCCCC
PFDVATGKTTGSKPGAASYTGIFGDTLAQLARENEKIVAITAAMPDGTGLTGFAKEFPER
CCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHCCCCEEEEEEECCCCCCCCHHHHHHHHH
FFDVGIAEQHAVTFAAGLAAEGFRPVTAIYSTFLQRAYDQVFHDVCLQNLPVVFALDRGG
HHHCCCCHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCEEEEECCCC
VVGDDGPTHHGVFDLSYLRHLPGMTLMAPKDENELRHMLKTAVSHDGPIALRYPRGAGCG
CCCCCCCCCCCEEEHHHHHHCCCCEEECCCCHHHHHHHHHHHHCCCCCEEEECCCCCCCC
IPLDQELREIPIGTGEILAEGDDVAIIAIGITVLPALEAARTLAEKGIRATVINARFVKP
CCCHHHHHHCCCCCCCEEECCCCEEEEEEHHHHHHHHHHHHHHHHCCCEEEEECHHHCCC
LDREMILQAARRTGCIITAEENALQGGFGSAVLELLADEGMTGVRVKRLGIPDRFVEQGP
CCHHHHHHHHHHCCEEEEECCCCCCCCHHHHHHHHHHHCCCCCEEEEECCCCHHHHHCCC
QPQLRADLGIDAAGIAAATEAFLAAKGAPAPALSMVK
CCCHHHCCCCCHHHHHHHHHHHHHCCCCCCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA