Definition Chloroflexus sp. Y-400-fl chromosome, complete genome.
Accession NC_012032
Length 5,268,950

Click here to switch to the map view.

The map label for this gene is zwf [H]

Identifier: 222523829

GI number: 222523829

Start: 641300

End: 642820

Strand: Direct

Name: zwf [H]

Synonym: Chy400_0537

Alternate gene names: 222523829

Gene position: 641300-642820 (Clockwise)

Preceding gene: 222523828

Following gene: 222523830

Centisome position: 12.17

GC content: 56.67

Gene sequence:

>1521_bases
GTGACAACCAATGTCCTGGACAATCCGCTCCGGGCCGGACTACGGATAGGGCGTACCCCTGAACCCTGTACAATGGTCAT
CTTCGGCGCCAGTGGTGACCTGACCAGTCGCAAACTGGTGCCGGCCCTCTACAATCTGGCCCGTGAGCGCCGCCTGCCTG
GCGGCTTCTCAGTCGTGGGGTTTGCCCGTCGCGATTGGACAGACGAAACATTCCGCGAACTGTTGCGCGAAGCGGTTAAT
GCCAATTCACGCTCTGGCGCAGTTGATCCAGATTTATGGGCAAGTTTTGCGCAAGGCATTCAATATCATCGCGGTAGTTT
TGACGATGCAGATGCCTATACCCGTCTGGCCGAACGACTGGCAACTATCGATGCCGAGCGTGGGACCGGCGGGAATAGAG
TCTTTTACCTGGCGACCCCTCCTGAAGCCTACCCAACCATCATCGCCCAACTAGGCGCGCATGGTCTGGCGCATTCGCAT
GGTTGGACGCGGATCATTATCGAAAAGCCGTTTGGGCACGATCTGAACAGTGCCCAGGCACTCAATGCCGAGGTTTTGTC
GGTCTTCAGCGAAGATCAGGTCTATCGCATTGACCACTATCTCGGCAAAGAGACGGTGCAAAATATCTTGATTTTTCGCT
TTGCGAACGGCATCTTCGAGCCGATCTGGAATCGGAGCCATATTGACCATGTCCAGATCACGGTTGCCGAAACCATCGGG
GTTGAAGATCGCGGCGGCTATTACGACACCTCAGGTGCGTTGCGCGACATGATCCAGAACCACCTGATGCAATTGCTGTG
TCTGGTGGCCATGGAACCGCCGGCAGTCTATGATGCCGATGCAGTTCGTGACGAAAAGGTGAAGGTGCTGCGCGCAATCC
GGCCATTGTCGGTCAATGATACGGTACGTGGTCAGTACGGGCCGGGTAGTGCCAATGGCCGACCGGTGCGGGGGTATCGG
GAAGAGAAGGGGGTTTCGCCAACTTCACAGACCGAAACCTACGTCGCCCTGAAACTCTTCATCGACAACTGGCGCTGGGC
CGGGGTGCCATTCTATCTACGCAGTGGCAAGCGACTCCCGCGTCGGGTAAGCGAGATTGCGATCCAGTTCAAAGCGGCAC
CGACAATGATCTTTGCCGATACGCCACTGAACGATCTTGAACCCAACGTCTTGGCGATGAAGATTCAACCCGATGAAGGC
ATCTCGCTGAAATTCAGTTCAAAGGTGCCGGGTCAACCACAAATCCGTCCGGTCACTATGGATTTCCGCTACGGTGCCTC
GTTTGGGGTCACCTCGCCCGAAGCCTACGAACGCCTCTTGCTCGATTGTATGCTCGGCGATGGTACACTGTTCACGCGAC
GCGATGAGGTCGAGACCAGTTGGGCATTGTTAACCCCTATTTTGCGCGACTGGGCCGAAGGTCCGCCACAACCGTTTCCC
AATTACGAGGCGGGGAGTTGGGGACCCGCCGCAGCCGATGAATTTATCGCTCGCGATGGCCGATTCTGGCGGCGATTGTG
A

Upstream 100 bases:

>100_bases
TTTCCGTTCACGGCAAGAAGACAGCTTCAGCATGAAGGTGCTGGCCGCTTTGCGCCAGCAGTTTGGTGGCCACGCCGTCA
AGAAGGTGGAGTAGATCAAC

Downstream 100 bases:

>100_bases
CATGGTGGAAAACTATGAGTGAGGTGGCAATCGATATCAGCGCCATCGAGCGTGAATTACGCCAGATGTGGCAAGAGCAG
GCCAACCATCCCGACGCCGG

Product: glucose-6-phosphate 1-dehydrogenase

Products: NA

Alternate protein names: G6PD [H]

Number of amino acids: Translated: 506; Mature: 505

Protein sequence:

>506_residues
MTTNVLDNPLRAGLRIGRTPEPCTMVIFGASGDLTSRKLVPALYNLARERRLPGGFSVVGFARRDWTDETFRELLREAVN
ANSRSGAVDPDLWASFAQGIQYHRGSFDDADAYTRLAERLATIDAERGTGGNRVFYLATPPEAYPTIIAQLGAHGLAHSH
GWTRIIIEKPFGHDLNSAQALNAEVLSVFSEDQVYRIDHYLGKETVQNILIFRFANGIFEPIWNRSHIDHVQITVAETIG
VEDRGGYYDTSGALRDMIQNHLMQLLCLVAMEPPAVYDADAVRDEKVKVLRAIRPLSVNDTVRGQYGPGSANGRPVRGYR
EEKGVSPTSQTETYVALKLFIDNWRWAGVPFYLRSGKRLPRRVSEIAIQFKAAPTMIFADTPLNDLEPNVLAMKIQPDEG
ISLKFSSKVPGQPQIRPVTMDFRYGASFGVTSPEAYERLLLDCMLGDGTLFTRRDEVETSWALLTPILRDWAEGPPQPFP
NYEAGSWGPAAADEFIARDGRFWRRL

Sequences:

>Translated_506_residues
MTTNVLDNPLRAGLRIGRTPEPCTMVIFGASGDLTSRKLVPALYNLARERRLPGGFSVVGFARRDWTDETFRELLREAVN
ANSRSGAVDPDLWASFAQGIQYHRGSFDDADAYTRLAERLATIDAERGTGGNRVFYLATPPEAYPTIIAQLGAHGLAHSH
GWTRIIIEKPFGHDLNSAQALNAEVLSVFSEDQVYRIDHYLGKETVQNILIFRFANGIFEPIWNRSHIDHVQITVAETIG
VEDRGGYYDTSGALRDMIQNHLMQLLCLVAMEPPAVYDADAVRDEKVKVLRAIRPLSVNDTVRGQYGPGSANGRPVRGYR
EEKGVSPTSQTETYVALKLFIDNWRWAGVPFYLRSGKRLPRRVSEIAIQFKAAPTMIFADTPLNDLEPNVLAMKIQPDEG
ISLKFSSKVPGQPQIRPVTMDFRYGASFGVTSPEAYERLLLDCMLGDGTLFTRRDEVETSWALLTPILRDWAEGPPQPFP
NYEAGSWGPAAADEFIARDGRFWRRL
>Mature_505_residues
TTNVLDNPLRAGLRIGRTPEPCTMVIFGASGDLTSRKLVPALYNLARERRLPGGFSVVGFARRDWTDETFRELLREAVNA
NSRSGAVDPDLWASFAQGIQYHRGSFDDADAYTRLAERLATIDAERGTGGNRVFYLATPPEAYPTIIAQLGAHGLAHSHG
WTRIIIEKPFGHDLNSAQALNAEVLSVFSEDQVYRIDHYLGKETVQNILIFRFANGIFEPIWNRSHIDHVQITVAETIGV
EDRGGYYDTSGALRDMIQNHLMQLLCLVAMEPPAVYDADAVRDEKVKVLRAIRPLSVNDTVRGQYGPGSANGRPVRGYRE
EKGVSPTSQTETYVALKLFIDNWRWAGVPFYLRSGKRLPRRVSEIAIQFKAAPTMIFADTPLNDLEPNVLAMKIQPDEGI
SLKFSSKVPGQPQIRPVTMDFRYGASFGVTSPEAYERLLLDCMLGDGTLFTRRDEVETSWALLTPILRDWAEGPPQPFPN
YEAGSWGPAAADEFIARDGRFWRRL

Specific function: Pentose phosphate pathway; first step. [C]

COG id: COG0364

COG function: function code G; Glucose-6-phosphate 1-dehydrogenase

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the glucose-6-phosphate dehydrogenase family [H]

Homologues:

Organism=Homo sapiens, GI109389365, Length=481, Percent_Identity=41.3721413721414, Blast_Score=359, Evalue=4e-99,
Organism=Homo sapiens, GI108773793, Length=481, Percent_Identity=41.3721413721414, Blast_Score=359, Evalue=4e-99,
Organism=Homo sapiens, GI52145310, Length=494, Percent_Identity=32.7935222672065, Blast_Score=202, Evalue=8e-52,
Organism=Escherichia coli, GI1788158, Length=498, Percent_Identity=43.3734939759036, Blast_Score=420, Evalue=1e-118,
Organism=Caenorhabditis elegans, GI17538218, Length=484, Percent_Identity=40.702479338843, Blast_Score=380, Evalue=1e-105,
Organism=Saccharomyces cerevisiae, GI6324088, Length=482, Percent_Identity=37.9668049792531, Blast_Score=337, Evalue=2e-93,
Organism=Drosophila melanogaster, GI24643352, Length=476, Percent_Identity=39.9159663865546, Blast_Score=332, Evalue=3e-91,
Organism=Drosophila melanogaster, GI24643350, Length=476, Percent_Identity=39.9159663865546, Blast_Score=332, Evalue=4e-91,
Organism=Drosophila melanogaster, GI221513548, Length=484, Percent_Identity=31.198347107438, Blast_Score=241, Evalue=8e-64,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR001282
- InterPro:   IPR019796
- InterPro:   IPR022675
- InterPro:   IPR022674
- InterPro:   IPR016040 [H]

Pfam domain/function: PF02781 G6PD_C; PF00479 G6PD_N [H]

EC number: =1.1.1.49 [H]

Molecular weight: Translated: 56576; Mature: 56445

Theoretical pI: Translated: 6.44; Mature: 6.44

Prosite motif: PS00069 G6P_DEHYDROGENASE

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.6 %Cys     (Translated Protein)
1.8 %Met     (Translated Protein)
2.4 %Cys+Met (Translated Protein)
0.6 %Cys     (Mature Protein)
1.6 %Met     (Mature Protein)
2.2 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MTTNVLDNPLRAGLRIGRTPEPCTMVIFGASGDLTSRKLVPALYNLARERRLPGGFSVVG
CCCCCCCCHHHHCEECCCCCCCCEEEEECCCCCCCHHHHHHHHHHHHHHHCCCCCCEEEE
FARRDWTDETFRELLREAVNANSRSGAVDPDLWASFAQGIQYHRGSFDDADAYTRLAERL
EHHCCCCHHHHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHH
ATIDAERGTGGNRVFYLATPPEAYPTIIAQLGAHGLAHSHGWTRIIIEKPFGHDLNSAQA
HHHCCCCCCCCCEEEEEECCCHHHHHHHHHHCCCCCCCCCCCEEEEEECCCCCCCCCHHH
LNAEVLSVFSEDQVYRIDHYLGKETVQNILIFRFANGIFEPIWNRSHIDHVQITVAETIG
HHHHHHHHHCCCCEEEHHHHHCHHHHHHHHHHHHHHHHHHHHCCCCCCCEEEEEEEHHCC
VEDRGGYYDTSGALRDMIQNHLMQLLCLVAMEPPAVYDADAVRDEKVKVLRAIRPLSVND
CCCCCCEECCHHHHHHHHHHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHCCCCCCC
TVRGQYGPGSANGRPVRGYREEKGVSPTSQTETYVALKLFIDNWRWAGVPFYLRSGKRLP
CCCCCCCCCCCCCCCCCCCHHHCCCCCCCCCCCEEEEEEEECCCEECCCCCEECCCCHHH
RRVSEIAIQFKAAPTMIFADTPLNDLEPNVLAMKIQPDEGISLKFSSKVPGQPQIRPVTM
HHHHHHHEEEECCCEEEEECCCCCCCCCCEEEEEECCCCCCEEEECCCCCCCCCEEEEEE
DFRYGASFGVTSPEAYERLLLDCMLGDGTLFTRRDEVETSWALLTPILRDWAEGPPQPFP
EEEECCCCCCCCHHHHHHHHHHHHCCCCEEEEECCCCHHHHHHHHHHHHHHHCCCCCCCC
NYEAGSWGPAAADEFIARDGRFWRRL
CCCCCCCCCHHHHHHHHCCCHHHHCC
>Mature Secondary Structure 
TTNVLDNPLRAGLRIGRTPEPCTMVIFGASGDLTSRKLVPALYNLARERRLPGGFSVVG
CCCCCCCHHHHCEECCCCCCCCEEEEECCCCCCCHHHHHHHHHHHHHHHCCCCCCEEEE
FARRDWTDETFRELLREAVNANSRSGAVDPDLWASFAQGIQYHRGSFDDADAYTRLAERL
EHHCCCCHHHHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHH
ATIDAERGTGGNRVFYLATPPEAYPTIIAQLGAHGLAHSHGWTRIIIEKPFGHDLNSAQA
HHHCCCCCCCCCEEEEEECCCHHHHHHHHHHCCCCCCCCCCCEEEEEECCCCCCCCCHHH
LNAEVLSVFSEDQVYRIDHYLGKETVQNILIFRFANGIFEPIWNRSHIDHVQITVAETIG
HHHHHHHHHCCCCEEEHHHHHCHHHHHHHHHHHHHHHHHHHHCCCCCCCEEEEEEEHHCC
VEDRGGYYDTSGALRDMIQNHLMQLLCLVAMEPPAVYDADAVRDEKVKVLRAIRPLSVND
CCCCCCEECCHHHHHHHHHHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHCCCCCCC
TVRGQYGPGSANGRPVRGYREEKGVSPTSQTETYVALKLFIDNWRWAGVPFYLRSGKRLP
CCCCCCCCCCCCCCCCCCCHHHCCCCCCCCCCCEEEEEEEECCCEECCCCCEECCCCHHH
RRVSEIAIQFKAAPTMIFADTPLNDLEPNVLAMKIQPDEGISLKFSSKVPGQPQIRPVTM
HHHHHHHEEEECCCEEEEECCCCCCCCCCEEEEEECCCCCCEEEECCCCCCCCCEEEEEE
DFRYGASFGVTSPEAYERLLLDCMLGDGTLFTRRDEVETSWALLTPILRDWAEGPPQPFP
EEEECCCCCCCCHHHHHHHHHHHHCCCCEEEEECCCCHHHHHHHHHHHHHHHCCCCCCCC
NYEAGSWGPAAADEFIARDGRFWRRL
CCCCCCCCCHHHHHHHHCCCHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 8905231 [H]