| Definition | Frankia sp. EAN1pec chromosome, complete genome. |
|---|---|
| Accession | NC_009921 |
| Length | 8,982,042 |
Click here to switch to the map view.
The map label for this gene is dxs
Identifier: 158316940
GI number: 158316940
Start: 6222873
End: 6224825
Strand: Reverse
Name: dxs
Synonym: Franean1_5184
Alternate gene names: 158316940
Gene position: 6224825-6222873 (Counterclockwise)
Preceding gene: 158316941
Following gene: 158316939
Centisome position: 69.3
GC content: 70.35
Gene sequence:
>1953_bases GTGTCGCTTCTGTCGACGATCGACAGCCCGCAGGACGTCAAGCGCCTCGACCATGAGGAGCTGGTGACGCTCGCGGCTGA GATCCGTGATTTCCTCATCCACGCGGTTGCCCGCACAGGCGGCCACCTAGGGCCGAATCTGGGCGCTGTAGAACTGACTC TCGCAATCCACCGAGTGTTCGATTCACCATTCGACCGTGTCCTCTGGGACACGGGCCACCAGTCCTATGTTCACAAGATT CTGACCGGCCGCCGGGAGCAGTTCGACCGCCTCCGTCAACGCGGCGGGCTCTCCGGCTACCCGAGCCAGGCCGAGTCCGA GCACGACATCATCGAGAACTCGCACGCCTCCACGGCGCTGTCGTACGCCGACGGGCTGTCCCGCGCCTACGAGCTGCGCG GGGAGAACCGGGCCGTCGTCGCGGTCGTCGGCGACGGGGCGCTGACCGGCGGAATGTGCTGGGAGGCGCTGAACAACATC GCCGCCAGCGACCGGCAGGTCGTCATCGTCGTCAACGACAACGGCCGGTCCTACTCACCCACCATCGGCGGCCTCGCCGA CCACCTCGCGTCGCTGCGCCTGGCGCCCGAGTACGAGCAGGTCCTGGACGTCGTCAAGCAGGTGCTGGGCCGCACCCCGC TCGTCGGCGCACCGCTGTTCGACGCCCTGCACGGCATCAAGAAGGGCATCAAGGACGTCGTCACCCCGCAGGGCATGTTC GAGGACCTCGGGCTGAAGTACGTCGGCCCGGTCGACGGCCACGACGTGGTCGCCATGGAGTCGGCGCTGCGCCGGGCCAA GGACTTCGGCGGCCCGGTGATCGTCCACGCCATGACCCGCAAGGGCTTCGGGTACCCGGCGGCCGAGCAGGACGACGCCG ACAACTTCCACGCCGTCGGCGTCATCGACCCGGTGACCGGCAAGCCGAAGTCGGCGTCCAAGGGCACCACCTGGACCTCG ATCTTCTCCGAGGAGATCGTCCGGATCGGCTCCGAGCGGCCCGACGTGGTCACCATGACCGCGGCGATGCTCCAGCCGGT CGGCCTGAAGTCGTTCGCCAAGGCCTTCCCGGACCGGGTCTTCGACGTCGGCATCGCCGAGCAGCACGCGGTCACCTCGG CCGCCGGCCTGGCCATGGGCGGTCTCAAGCCCGTTGTGTGCATCTACGCGACGTTCCTGAACCGCGCCTTCGACCAGGTC CTCATGGACGTCGCCATGCACCGCCAGCCGGTGACCTTCGTGCTCGACCGCGCCGGGATCACCGGCGAGGACGGCGCGTC CCACAACGGCATGTGGGACATGTCCTTCCTGCAGGTCGTGCCGGGTCTGGCGATCGCCGCCCCGCGTGACGCCGCGACCC TGCGCGCCGAGCTCGACGAGGCGGTCTCCAACACCGACGGCCCGACGGTCGTGCGTTACCCCAAGGGCAAGGTCGCCGCG GACTCCCCGGCGATCGACCAGGTCGGCGGGGTCGACGTCCTCTACCGGGCGCCGGCGGCCGCGCGGCACCGCGAGGTGCT GCTCGTCTCGATCGGCGCGATGGCCCCGACCTGTCTGGACGTCGCCGAGCGTGTCGCCAGCCAGGGCATCGGCATCACCG TGGTCGACCCGCGGTGGGTCAAGCCGCTCGACCCGGCGCTGGTCGACCTCGCCCGTGACCACGACCTCGTCGTCACCGTC GAGGACAACGGGCGGGTCGGTGGCGTCGGTGCCTGCGTCGCGCAGCTGCTGCGGGACGCCGACGTCGACGTCCCGGTGCG TGAGTTCGGGGTCGCCCAGCGCTTCCTCGACCACGGCAAGCGCGACGACGTGCTGGCCGAGGTCGGCCTCGCCCCGCAGG ACCTGGCCCGCAAGGTGATCGAGGCGGTCGCCAAGCGCCAGCACGCCCTCATGGGCGACGAGGTCGGCGCGGACGAGTCC AACCAGACCCCCGCCGGCGGCGGTCAGGCCTGA
Upstream 100 bases:
>100_bases GCAGCTCACATGTCGGGAGCCTGTCTGCGGAGCCCGGGGTGCCCTGCGTAGACTTTGCCGGACCCGGACCGATCCCCTTT CGGGGGAGGGAGAGCACGCC
Downstream 100 bases:
>100_bases CCGGCCGGGCCTGACCGGCCGGGCCTGACCGGCCGGGCCTGACCGGCCAGGCCTGACCGGCGCGGCCGGGTCGCGCCCGC GCCCGGCCCGGCGCGGGTGC
Product: 1-deoxy-D-xylulose-5-phosphate synthase
Products: NA
Alternate protein names: 1-deoxyxylulose-5-phosphate synthase; DXP synthase; DXPS
Number of amino acids: Translated: 650; Mature: 649
Protein sequence:
>650_residues MSLLSTIDSPQDVKRLDHEELVTLAAEIRDFLIHAVARTGGHLGPNLGAVELTLAIHRVFDSPFDRVLWDTGHQSYVHKI LTGRREQFDRLRQRGGLSGYPSQAESEHDIIENSHASTALSYADGLSRAYELRGENRAVVAVVGDGALTGGMCWEALNNI AASDRQVVIVVNDNGRSYSPTIGGLADHLASLRLAPEYEQVLDVVKQVLGRTPLVGAPLFDALHGIKKGIKDVVTPQGMF EDLGLKYVGPVDGHDVVAMESALRRAKDFGGPVIVHAMTRKGFGYPAAEQDDADNFHAVGVIDPVTGKPKSASKGTTWTS IFSEEIVRIGSERPDVVTMTAAMLQPVGLKSFAKAFPDRVFDVGIAEQHAVTSAAGLAMGGLKPVVCIYATFLNRAFDQV LMDVAMHRQPVTFVLDRAGITGEDGASHNGMWDMSFLQVVPGLAIAAPRDAATLRAELDEAVSNTDGPTVVRYPKGKVAA DSPAIDQVGGVDVLYRAPAAARHREVLLVSIGAMAPTCLDVAERVASQGIGITVVDPRWVKPLDPALVDLARDHDLVVTV EDNGRVGGVGACVAQLLRDADVDVPVREFGVAQRFLDHGKRDDVLAEVGLAPQDLARKVIEAVAKRQHALMGDEVGADES NQTPAGGGQA
Sequences:
>Translated_650_residues MSLLSTIDSPQDVKRLDHEELVTLAAEIRDFLIHAVARTGGHLGPNLGAVELTLAIHRVFDSPFDRVLWDTGHQSYVHKI LTGRREQFDRLRQRGGLSGYPSQAESEHDIIENSHASTALSYADGLSRAYELRGENRAVVAVVGDGALTGGMCWEALNNI AASDRQVVIVVNDNGRSYSPTIGGLADHLASLRLAPEYEQVLDVVKQVLGRTPLVGAPLFDALHGIKKGIKDVVTPQGMF EDLGLKYVGPVDGHDVVAMESALRRAKDFGGPVIVHAMTRKGFGYPAAEQDDADNFHAVGVIDPVTGKPKSASKGTTWTS IFSEEIVRIGSERPDVVTMTAAMLQPVGLKSFAKAFPDRVFDVGIAEQHAVTSAAGLAMGGLKPVVCIYATFLNRAFDQV LMDVAMHRQPVTFVLDRAGITGEDGASHNGMWDMSFLQVVPGLAIAAPRDAATLRAELDEAVSNTDGPTVVRYPKGKVAA DSPAIDQVGGVDVLYRAPAAARHREVLLVSIGAMAPTCLDVAERVASQGIGITVVDPRWVKPLDPALVDLARDHDLVVTV EDNGRVGGVGACVAQLLRDADVDVPVREFGVAQRFLDHGKRDDVLAEVGLAPQDLARKVIEAVAKRQHALMGDEVGADES NQTPAGGGQA >Mature_649_residues SLLSTIDSPQDVKRLDHEELVTLAAEIRDFLIHAVARTGGHLGPNLGAVELTLAIHRVFDSPFDRVLWDTGHQSYVHKIL TGRREQFDRLRQRGGLSGYPSQAESEHDIIENSHASTALSYADGLSRAYELRGENRAVVAVVGDGALTGGMCWEALNNIA ASDRQVVIVVNDNGRSYSPTIGGLADHLASLRLAPEYEQVLDVVKQVLGRTPLVGAPLFDALHGIKKGIKDVVTPQGMFE DLGLKYVGPVDGHDVVAMESALRRAKDFGGPVIVHAMTRKGFGYPAAEQDDADNFHAVGVIDPVTGKPKSASKGTTWTSI FSEEIVRIGSERPDVVTMTAAMLQPVGLKSFAKAFPDRVFDVGIAEQHAVTSAAGLAMGGLKPVVCIYATFLNRAFDQVL MDVAMHRQPVTFVLDRAGITGEDGASHNGMWDMSFLQVVPGLAIAAPRDAATLRAELDEAVSNTDGPTVVRYPKGKVAAD SPAIDQVGGVDVLYRAPAAARHREVLLVSIGAMAPTCLDVAERVASQGIGITVVDPRWVKPLDPALVDLARDHDLVVTVE DNGRVGGVGACVAQLLRDADVDVPVREFGVAQRFLDHGKRDDVLAEVGLAPQDLARKVIEAVAKRQHALMGDEVGADESN QTPAGGGQA
Specific function: Catalyzes the acyloin condensation reaction between C atoms 2 and 3 of pyruvate and glyceraldehyde 3-phosphate to yield 1-deoxy-D-xylulose-5-phosphate (DXP)
COG id: COG1154
COG function: function code HI; Deoxyxylulose-5-phosphate synthase
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the transketolase family. DXPS subfamily
Homologues:
Organism=Homo sapiens, GI205277463, Length=259, Percent_Identity=27.4131274131274, Blast_Score=93, Evalue=8e-19, Organism=Homo sapiens, GI4507521, Length=259, Percent_Identity=27.4131274131274, Blast_Score=93, Evalue=8e-19, Organism=Homo sapiens, GI133778974, Length=423, Percent_Identity=27.6595744680851, Blast_Score=91, Evalue=2e-18, Organism=Homo sapiens, GI225637459, Length=421, Percent_Identity=25.6532066508314, Blast_Score=79, Evalue=9e-15, Organism=Homo sapiens, GI225637461, Length=421, Percent_Identity=25.6532066508314, Blast_Score=79, Evalue=1e-14, Organism=Homo sapiens, GI225637463, Length=423, Percent_Identity=26.241134751773, Blast_Score=79, Evalue=1e-14, Organism=Escherichia coli, GI1786622, Length=620, Percent_Identity=40.3225806451613, Blast_Score=476, Evalue=1e-135, Organism=Caenorhabditis elegans, GI17539652, Length=413, Percent_Identity=24.9394673123487, Blast_Score=91, Evalue=2e-18, Organism=Drosophila melanogaster, GI24666278, Length=267, Percent_Identity=32.2097378277154, Blast_Score=109, Evalue=7e-24, Organism=Drosophila melanogaster, GI45551847, Length=374, Percent_Identity=28.0748663101604, Blast_Score=95, Evalue=1e-19, Organism=Drosophila melanogaster, GI45550715, Length=374, Percent_Identity=28.0748663101604, Blast_Score=95, Evalue=1e-19, Organism=Drosophila melanogaster, GI24645119, Length=374, Percent_Identity=28.0748663101604, Blast_Score=95, Evalue=2e-19,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): DXS_FRASN (A8L0K9)
Other databases:
- EMBL: CP000820 - RefSeq: YP_001509448.1 - ProteinModelPortal: A8L0K9 - SMR: A8L0K9 - GeneID: 5673518 - GenomeReviews: CP000820_GR - KEGG: fre:Franean1_5184 - HOGENOM: HBG571647 - OMA: QRFPDRY - ProtClustDB: PRK05444 - BioCyc: FSP1855:FRANEAN1_5184-MONOMER - HAMAP: MF_00315 - InterPro: IPR001017 - InterPro: IPR005477 - InterPro: IPR009014 - InterPro: IPR015941 - InterPro: IPR005475 - InterPro: IPR020826 - InterPro: IPR005476 - InterPro: IPR005474 - Gene3D: G3DSA:3.40.50.920 - SMART: SM00861 - TIGRFAMs: TIGR00204
Pfam domain/function: PF00676 E1_dh; PF02779 Transket_pyr; PF02780 Transketolase_C; SSF52922 Transketo_C_like
EC number: =2.2.1.7
Molecular weight: Translated: 69351; Mature: 69220
Theoretical pI: Translated: 5.28; Mature: 5.28
Prosite motif: PS00801 TRANSKETOLASE_1; PS00802 TRANSKETOLASE_2
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.6 %Cys (Translated Protein) 2.2 %Met (Translated Protein) 2.8 %Cys+Met (Translated Protein) 0.6 %Cys (Mature Protein) 2.0 %Met (Mature Protein) 2.6 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MSLLSTIDSPQDVKRLDHEELVTLAAEIRDFLIHAVARTGGHLGPNLGAVELTLAIHRVF CCHHHHCCCHHHHHHCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHH DSPFDRVLWDTGHQSYVHKILTGRREQFDRLRQRGGLSGYPSQAESEHDIIENSHASTAL CCHHHHHHHCCCHHHHHHHHHCCCHHHHHHHHHCCCCCCCCCCCCCHHHHHHCCCHHHHH SYADGLSRAYELRGENRAVVAVVGDGALTGGMCWEALNNIAASDRQVVIVVNDNGRSYSP HHHHHHHHHHHHCCCCCEEEEEECCCCCCHHHHHHHHHHHHCCCCEEEEEECCCCCEECC TIGGLADHLASLRLAPEYEQVLDVVKQVLGRTPLVGAPLFDALHGIKKGIKDVVTPQGMF CHHHHHHHHHHHCCCCCHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHCCCCCHH EDLGLKYVGPVDGHDVVAMESALRRAKDFGGPVIVHAMTRKGFGYPAAEQDDADNFHAVG HHCCCEEECCCCCCHHHHHHHHHHHHHHCCCCEEEEEEHHCCCCCCCCCCCCCCCEEEEE VIDPVTGKPKSASKGTTWTSIFSEEIVRIGSERPDVVTMTAAMLQPVGLKSFAKAFPDRV EECCCCCCCCCCCCCCHHHHHHHHHHHHHCCCCCCEEEHHHHHHCCCCHHHHHHHCCHHH FDVGIAEQHAVTSAAGLAMGGLKPVVCIYATFLNRAFDQVLMDVAMHRQPVTFVLDRAGI HCCCCCHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCCEEEEECCCC TGEDGASHNGMWDMSFLQVVPGLAIAAPRDAATLRAELDEAVSNTDGPTVVRYPKGKVAA CCCCCCCCCCCCCHHHHHHHCCCEEECCCCHHHHHHHHHHHHCCCCCCEEEECCCCCCCC DSPAIDQVGGVDVLYRAPAAARHREVLLVSIGAMAPTCLDVAERVASQGIGITVVDPRWV CCCCHHHCCCCCEEECCCCHHCCCEEEEEEECCCCHHHHHHHHHHHHCCCCEEEECCCCC KPLDPALVDLARDHDLVVTVEDNGRVGGVGACVAQLLRDADVDVPVREFGVAQRFLDHGK CCCCHHHHHHHCCCCEEEEECCCCCCCCHHHHHHHHHHHCCCCCCHHHHHHHHHHHHCCC RDDVLAEVGLAPQDLARKVIEAVAKRQHALMGDEVGADESNQTPAGGGQA CCCHHHHHCCCHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCC >Mature Secondary Structure SLLSTIDSPQDVKRLDHEELVTLAAEIRDFLIHAVARTGGHLGPNLGAVELTLAIHRVF CHHHHCCCHHHHHHCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHH DSPFDRVLWDTGHQSYVHKILTGRREQFDRLRQRGGLSGYPSQAESEHDIIENSHASTAL CCHHHHHHHCCCHHHHHHHHHCCCHHHHHHHHHCCCCCCCCCCCCCHHHHHHCCCHHHHH SYADGLSRAYELRGENRAVVAVVGDGALTGGMCWEALNNIAASDRQVVIVVNDNGRSYSP HHHHHHHHHHHHCCCCCEEEEEECCCCCCHHHHHHHHHHHHCCCCEEEEEECCCCCEECC TIGGLADHLASLRLAPEYEQVLDVVKQVLGRTPLVGAPLFDALHGIKKGIKDVVTPQGMF CHHHHHHHHHHHCCCCCHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHCCCCCHH EDLGLKYVGPVDGHDVVAMESALRRAKDFGGPVIVHAMTRKGFGYPAAEQDDADNFHAVG HHCCCEEECCCCCCHHHHHHHHHHHHHHCCCCEEEEEEHHCCCCCCCCCCCCCCCEEEEE VIDPVTGKPKSASKGTTWTSIFSEEIVRIGSERPDVVTMTAAMLQPVGLKSFAKAFPDRV EECCCCCCCCCCCCCCHHHHHHHHHHHHHCCCCCCEEEHHHHHHCCCCHHHHHHHCCHHH FDVGIAEQHAVTSAAGLAMGGLKPVVCIYATFLNRAFDQVLMDVAMHRQPVTFVLDRAGI HCCCCCHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCCEEEEECCCC TGEDGASHNGMWDMSFLQVVPGLAIAAPRDAATLRAELDEAVSNTDGPTVVRYPKGKVAA CCCCCCCCCCCCCHHHHHHHCCCEEECCCCHHHHHHHHHHHHCCCCCCEEEECCCCCCCC DSPAIDQVGGVDVLYRAPAAARHREVLLVSIGAMAPTCLDVAERVASQGIGITVVDPRWV CCCCHHHCCCCCEEECCCCHHCCCEEEEEEECCCCHHHHHHHHHHHHCCCCEEEECCCCC KPLDPALVDLARDHDLVVTVEDNGRVGGVGACVAQLLRDADVDVPVREFGVAQRFLDHGK CCCCHHHHHHHCCCCEEEEECCCCCCCCHHHHHHHHHHHCCCCCCHHHHHHHHHHHHCCC RDDVLAEVGLAPQDLARKVIEAVAKRQHALMGDEVGADESNQTPAGGGQA CCCHHHHHCCCHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: NA