Definition Treponema pallidum subsp. pallidum SS14, complete genome.
Accession NC_010741
Length 1,139,457

Click here to switch to the map view.

The map label for this gene is zwf

Identifier: 189025709

GI number: 189025709

Start: 508716

End: 510263

Strand: Reverse

Name: zwf

Synonym: TPASS_0478

Alternate gene names: 189025709

Gene position: 510263-508716 (Counterclockwise)

Preceding gene: 189025710

Following gene: 189025708

Centisome position: 44.78

GC content: 55.56

Gene sequence:

>1548_bases
ATGGGGAAAATCAGTGGCAGCGGCACGGTCGCGCCGCACATCCTGGTTATCTTTGGCGCTTCAGGCGACCTTGCCGCGCG
GAAGCTTATCCCCTCGCTTTGGGATCTCTTTGAGCAAGAGCTCCTGCCCCGTACATTCGGTATACTCGGCGCAGGGCGTA
CGGCTCTGTCTACAGAGTCTTTTCGCGCACGGCTTGCAGAGGCGGTCACAAAGCATGCAGTGCGCACACCGCACGACCCG
GCGCGCCTCACCGAATTCCTGCAGAAGATCCACTACTTCTCGTTCGATCCCACCGACTCTGTCGCCTTTGCCGACTTTGC
CACGTACGTGCGCACCCTCGACCAGTCGCTGCACACCGAGGGCAACTTTATCTTCTATCTTGCCACTCCCCCTAGCCTGT
ACGAAACTATCCCCACGCAGCTTGCTATGCACCACTTGAACCGGGAACAGGGTAATTTTCGCAGGGTAGTTATTGAAAAA
CCCTTTGGCTACAACCTAGAAACCGCGCAGCACCTTAATGCGAGCTTGCGTGCCCACTTTCAGGAAAACCAAACCTATCG
CATCGATCACTATCTGGGTAAGGAAACGGTCCAAAACATCCTGGTCACTCGCTTTGCCAATCCCCTTTTCGAGCCCACAT
GGAACCGGACCCATATCGATTACGTTGAAATTACTGCAAGCGAATCACTAGGTGTCGAAAACCGCGGCGGTTACTACGAC
CAGTCCGGTGCATTGCGCGATATGATCCAAAACCACTTGTTACTCCTCTTGGGTATTATCGCGATGGAGGCGCCCGCCGT
CGTGAGTTCAAGTCGTCTACGGGATGAAATCGTAAAGGTCTTTGACTGCCTGCGCCCTATGGGAGAACGCGACGTCATGC
AGCATACGGTGCGTGCCCAATACGTCGCCGGCAAGATACGCGGTGTAGCCGTCCCCGGCTACCTTGAGGAGTCAGGCGTT
GACCCTCGCTCGTGCACTGAAACCTTTGCCGCACTCAAGTGCTACATCGACAATTGGCGGTGGATGGACGTTCCCTTCTA
CCTGCGGACGGGTAAGCGTTTGCCCACGGGCGTCACTGAGGTGATCGTCCATTACCGAACGCTCCCCATCGCGCTTTTCG
AGCACATCGAACGCCCGTGCGCACGCGAGGGCAACGCGCTTGTCATTCGCATTCAACCCGACGAAGGAATTCAGCTTAAA
ATCGACCTCAAAGAGCCCGGCGCGGGGTTCAAGACTATTCCCGTCAGTGTTGATTTTCAGTATTCGGCTCTTACCTATTC
GCACTTACCCAGCGCGTATGAGCGGCTATTGCTTGACTGCATGAATGGAGACAACACGCTCTACCATCGAGATGACGCGG
TGGAGTCTGCATGGCGCTTCATAGATCCTATTCTTGCCGCATGGAAATCAAACAAGAGTCCTCTACTTACGTACCCTGCA
GGAAGCTGGGGTCCGAAGGCTGCAGACGACCTGATCAAAGGGAGTGCTCCACGGTGGCATCACCCCTCTTCTACGCTGCT
CAGCGATGATTTTGCCTGCCGACTCTAG

Upstream 100 bases:

>100_bases
AAAAATAGGGCCGGTGTTCCGCATTTAGTGCCTTAGGGAGCGGAGAGTCTGCCTGCGGCACATCCGGTGTAGGTCGCACC
GTTGAAAGAAGGGGCGGTTT

Downstream 100 bases:

>100_bases
CGGTAATGCCGAGCCTTGAACGACACTAGAACGTAGCGGGAGAGAGGAGGATGTTCGCCCATGAAGAAGCATATTTTTGA
GGATGCGCGTGCCATCGCGG

Product: glucose-6-phosphate 1-dehydrogenase

Products: NA

Alternate protein names: G6PD

Number of amino acids: Translated: 515; Mature: 514

Protein sequence:

>515_residues
MGKISGSGTVAPHILVIFGASGDLAARKLIPSLWDLFEQELLPRTFGILGAGRTALSTESFRARLAEAVTKHAVRTPHDP
ARLTEFLQKIHYFSFDPTDSVAFADFATYVRTLDQSLHTEGNFIFYLATPPSLYETIPTQLAMHHLNREQGNFRRVVIEK
PFGYNLETAQHLNASLRAHFQENQTYRIDHYLGKETVQNILVTRFANPLFEPTWNRTHIDYVEITASESLGVENRGGYYD
QSGALRDMIQNHLLLLLGIIAMEAPAVVSSSRLRDEIVKVFDCLRPMGERDVMQHTVRAQYVAGKIRGVAVPGYLEESGV
DPRSCTETFAALKCYIDNWRWMDVPFYLRTGKRLPTGVTEVIVHYRTLPIALFEHIERPCAREGNALVIRIQPDEGIQLK
IDLKEPGAGFKTIPVSVDFQYSALTYSHLPSAYERLLLDCMNGDNTLYHRDDAVESAWRFIDPILAAWKSNKSPLLTYPA
GSWGPKAADDLIKGSAPRWHHPSSTLLSDDFACRL

Sequences:

>Translated_515_residues
MGKISGSGTVAPHILVIFGASGDLAARKLIPSLWDLFEQELLPRTFGILGAGRTALSTESFRARLAEAVTKHAVRTPHDP
ARLTEFLQKIHYFSFDPTDSVAFADFATYVRTLDQSLHTEGNFIFYLATPPSLYETIPTQLAMHHLNREQGNFRRVVIEK
PFGYNLETAQHLNASLRAHFQENQTYRIDHYLGKETVQNILVTRFANPLFEPTWNRTHIDYVEITASESLGVENRGGYYD
QSGALRDMIQNHLLLLLGIIAMEAPAVVSSSRLRDEIVKVFDCLRPMGERDVMQHTVRAQYVAGKIRGVAVPGYLEESGV
DPRSCTETFAALKCYIDNWRWMDVPFYLRTGKRLPTGVTEVIVHYRTLPIALFEHIERPCAREGNALVIRIQPDEGIQLK
IDLKEPGAGFKTIPVSVDFQYSALTYSHLPSAYERLLLDCMNGDNTLYHRDDAVESAWRFIDPILAAWKSNKSPLLTYPA
GSWGPKAADDLIKGSAPRWHHPSSTLLSDDFACRL
>Mature_514_residues
GKISGSGTVAPHILVIFGASGDLAARKLIPSLWDLFEQELLPRTFGILGAGRTALSTESFRARLAEAVTKHAVRTPHDPA
RLTEFLQKIHYFSFDPTDSVAFADFATYVRTLDQSLHTEGNFIFYLATPPSLYETIPTQLAMHHLNREQGNFRRVVIEKP
FGYNLETAQHLNASLRAHFQENQTYRIDHYLGKETVQNILVTRFANPLFEPTWNRTHIDYVEITASESLGVENRGGYYDQ
SGALRDMIQNHLLLLLGIIAMEAPAVVSSSRLRDEIVKVFDCLRPMGERDVMQHTVRAQYVAGKIRGVAVPGYLEESGVD
PRSCTETFAALKCYIDNWRWMDVPFYLRTGKRLPTGVTEVIVHYRTLPIALFEHIERPCAREGNALVIRIQPDEGIQLKI
DLKEPGAGFKTIPVSVDFQYSALTYSHLPSAYERLLLDCMNGDNTLYHRDDAVESAWRFIDPILAAWKSNKSPLLTYPAG
SWGPKAADDLIKGSAPRWHHPSSTLLSDDFACRL

Specific function: Pentose phosphate pathway; first step. [C]

COG id: COG0364

COG function: function code G; Glucose-6-phosphate 1-dehydrogenase

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the glucose-6-phosphate dehydrogenase family

Homologues:

Organism=Homo sapiens, GI109389365, Length=483, Percent_Identity=38.7163561076605, Blast_Score=327, Evalue=1e-89,
Organism=Homo sapiens, GI108773793, Length=483, Percent_Identity=38.7163561076605, Blast_Score=327, Evalue=2e-89,
Organism=Homo sapiens, GI52145310, Length=499, Percent_Identity=29.8597194388778, Blast_Score=164, Evalue=1e-40,
Organism=Escherichia coli, GI1788158, Length=490, Percent_Identity=42.8571428571429, Blast_Score=377, Evalue=1e-106,
Organism=Caenorhabditis elegans, GI17538218, Length=487, Percent_Identity=35.7289527720739, Blast_Score=315, Evalue=3e-86,
Organism=Saccharomyces cerevisiae, GI6324088, Length=486, Percent_Identity=35.1851851851852, Blast_Score=292, Evalue=7e-80,
Organism=Drosophila melanogaster, GI24643350, Length=482, Percent_Identity=37.9668049792531, Blast_Score=306, Evalue=3e-83,
Organism=Drosophila melanogaster, GI24643352, Length=482, Percent_Identity=37.7593360995851, Blast_Score=305, Evalue=4e-83,
Organism=Drosophila melanogaster, GI221513548, Length=508, Percent_Identity=30.1181102362205, Blast_Score=207, Evalue=2e-53,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): G6PD_TREPA (O83491)

Other databases:

- EMBL:   AE000520
- PIR:   D71319
- RefSeq:   NP_218919.1
- ProteinModelPortal:   O83491
- SMR:   O83491
- IntAct:   O83491
- GeneID:   2611128
- GenomeReviews:   AE000520_GR
- KEGG:   tpa:TP0478
- NMPDR:   fig|243276.1.peg.478
- TIGR:   TP_0478
- HOGENOM:   HBG322449
- OMA:   CMTAMEA
- ProtClustDB:   PRK05722
- BioCyc:   TPAL243276:TP_0478-MONOMER
- BRENDA:   1.1.1.49
- GO:   GO:0005488
- InterPro:   IPR001282
- InterPro:   IPR019796
- InterPro:   IPR022675
- InterPro:   IPR022674
- InterPro:   IPR016040
- Gene3D:   G3DSA:3.40.50.720
- PANTHER:   PTHR23429
- PIRSF:   PIRSF000110
- PRINTS:   PR00079
- TIGRFAMs:   TIGR00871

Pfam domain/function: PF02781 G6PD_C; PF00479 G6PD_N

EC number: =1.1.1.49

Molecular weight: Translated: 58033; Mature: 57902

Theoretical pI: Translated: 6.83; Mature: 6.83

Prosite motif: PS00069 G6P_DEHYDROGENASE

Important sites: ACT_SITE 252-252 BINDING 21-21 BINDING 53-53 BINDING 190-190 BINDING 194-194

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.2 %Cys     (Translated Protein)
1.6 %Met     (Translated Protein)
2.7 %Cys+Met (Translated Protein)
1.2 %Cys     (Mature Protein)
1.4 %Met     (Mature Protein)
2.5 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MGKISGSGTVAPHILVIFGASGDLAARKLIPSLWDLFEQELLPRTFGILGAGRTALSTES
CCCCCCCCCCCCEEEEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHCHHH
FRARLAEAVTKHAVRTPHDPARLTEFLQKIHYFSFDPTDSVAFADFATYVRTLDQSLHTE
HHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHCCC
GNFIFYLATPPSLYETIPTQLAMHHLNREQGNFRRVVIEKPFGYNLETAQHLNASLRAHF
CCEEEEECCCHHHHHHHHHHHHHHHHCCCCCCEEEEEEECCCCCCCCHHHHHHHHHHHHH
QENQTYRIDHYLGKETVQNILVTRFANPLFEPTWNRTHIDYVEITASESLGVENRGGYYD
HCCCCEEEHHHHCHHHHHHHHHHHHCCCCCCCCCCCCEEEEEEEEECCCCCCCCCCCCCC
QSGALRDMIQNHLLLLLGIIAMEAPAVVSSSRLRDEIVKVFDCLRPMGERDVMQHTVRAQ
CCCHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHH
YVAGKIRGVAVPGYLEESGVDPRSCTETFAALKCYIDNWRWMDVPFYLRTGKRLPTGVTE
HHHHHCCEEECCCCHHHCCCCHHHHHHHHHHHHHHHCCCEEECCCCEEECCCCCCCCHHH
VIVHYRTLPIALFEHIERPCAREGNALVIRIQPDEGIQLKIDLKEPGAGFKTIPVSVDFQ
HHHHHHHHHHHHHHHHCCHHHCCCCEEEEEEECCCCCEEEEEECCCCCCCEEEEEEEEEE
YSALTYSHLPSAYERLLLDCMNGDNTLYHRDDAVESAWRFIDPILAAWKSNKSPLLTYPA
EHHHHHHHCHHHHHHHHHHHCCCCCCEEECCHHHHHHHHHHHHHHHHHCCCCCCEEEECC
GSWGPKAADDLIKGSAPRWHHPSSTLLSDDFACRL
CCCCCHHHHHHHCCCCCCCCCCCCCCCCCCCCCCC
>Mature Secondary Structure 
GKISGSGTVAPHILVIFGASGDLAARKLIPSLWDLFEQELLPRTFGILGAGRTALSTES
CCCCCCCCCCCEEEEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHCHHH
FRARLAEAVTKHAVRTPHDPARLTEFLQKIHYFSFDPTDSVAFADFATYVRTLDQSLHTE
HHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHCCC
GNFIFYLATPPSLYETIPTQLAMHHLNREQGNFRRVVIEKPFGYNLETAQHLNASLRAHF
CCEEEEECCCHHHHHHHHHHHHHHHHCCCCCCEEEEEEECCCCCCCCHHHHHHHHHHHHH
QENQTYRIDHYLGKETVQNILVTRFANPLFEPTWNRTHIDYVEITASESLGVENRGGYYD
HCCCCEEEHHHHCHHHHHHHHHHHHCCCCCCCCCCCCEEEEEEEEECCCCCCCCCCCCCC
QSGALRDMIQNHLLLLLGIIAMEAPAVVSSSRLRDEIVKVFDCLRPMGERDVMQHTVRAQ
CCCHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHH
YVAGKIRGVAVPGYLEESGVDPRSCTETFAALKCYIDNWRWMDVPFYLRTGKRLPTGVTE
HHHHHCCEEECCCCHHHCCCCHHHHHHHHHHHHHHHCCCEEECCCCEEECCCCCCCCHHH
VIVHYRTLPIALFEHIERPCAREGNALVIRIQPDEGIQLKIDLKEPGAGFKTIPVSVDFQ
HHHHHHHHHHHHHHHHCCHHHCCCCEEEEEEECCCCCEEEEEECCCCCCCEEEEEEEEEE
YSALTYSHLPSAYERLLLDCMNGDNTLYHRDDAVESAWRFIDPILAAWKSNKSPLLTYPA
EHHHHHHHCHHHHHHHHHHHCCCCCCEEECCHHHHHHHHHHHHHHHHHCCCCCCEEEECC
GSWGPKAADDLIKGSAPRWHHPSSTLLSDDFACRL
CCCCCHHHHHHHCCCCCCCCCCCCCCCCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 9665876