Definition Sphingopyxis alaskensis RB2256, complete genome.
Accession NC_008048
Length 3,345,170

Click here to switch to the map view.

The map label for this gene is zwf [H]

Identifier: 103485686

GI number: 103485686

Start: 200525

End: 202063

Strand: Direct

Name: zwf [H]

Synonym: Sala_0190

Alternate gene names: 103485686

Gene position: 200525-202063 (Clockwise)

Preceding gene: 103485682

Following gene: 103485687

Centisome position: 5.99

GC content: 63.55

Gene sequence:

>1539_bases
ATGCGGCTTACGTATGCGCGTTGCATTCGGGGGGCGCATCCTCCACTTCTCTCACTGCTATCCAAGGGGACGAATGTGAG
CGTCAAGGTCGAAACATTGGTGTTGTTCGGGGCAACGGGCGACCTGGCGCAGCGTATGCTTTTCCCCTCGCTCTACAATC
TGCACATGGACGGACTGCTCGCCGACGCGCTGACGATCGTCGGGTCGGGGCGCTCGGCGATGGACCGCGACGCCTTTCGG
GCGCAGGTCCGCGCCGCGCTGACCGAGTATCTGCCCGAAGACCGCATCGAGGCGGCGGTCGTCGACGGCTTCCTTGCGCG
CATCGATTATTGCGCGATCGACGCTGGCGCTGGCACCGGCTATGCGGAACTCGCGGCTTTGCTCGGCGACCGCATGGCGC
GCCCGATTGGCGTTTACCTCTCGACGCCGCCGTCGATGTTCGGACCGATCGCGCAGGGGCTTAAAGCTGCGAACATCGCG
TGCGCCGAATGCCGTATCGCGATGGAAAAGCCGATCGGCCACGACCTCGCCTCGTCGCGCGAAGTCAATGCCCAGGTCGG
CGACGCCTTTGCCGAGGACCGGGTGTTCCGCATCGACCATTATCTCGGCAAGGAAACGGTGCAGAATCTGCTCGCGCTGC
GCTTTGCCAACATGTTGTTCGAACCGCTGTGGAACGCGCAGGCGATCGACCATGTCCAGATCACCGTTGCCGAAACCGTC
GGGCTGGAGGGCCGCGTTTCCTATTATGACGGCGTCGGCGCGCTGAAGGACATGGTGCAGAATCACATGCTCCAACTGCT
CGCAATCATCGCGATGGAGCCCCCGGCCAGCGTCGGGGCGACCGCAGTGCGCGACGAAAAGGTCAAGCTGTTGCGCTCCT
TGCGCAAGATGACCGCGGAGGATGTAAAGGCGCACAGCGTCAAGGGCCAGTACAGCAGCGGCGCGGTTAACGGCGCCGCG
GTCGCGGGCTATGCCGACGAACTCGGCCAGCCGTCGAACACCGAAACCTTCGTCGCCTTGAAGGCCTTTATCGACAATTG
GCGGTGGAAGGGCGTGCCCTTTTACCTGCGCACCGGCAAACGGATGCCGCAGCGCAAATCCGAAGTGCTGATCCAGTTCA
AGCCCGTGCCGCACAATATCTTCGCGCGCGTCGGTGCGGGCAAGCTCGACGCGAACATGATGATCATCAATTTGCAGCCC
GAGGAAAATATCCGCGTCAAGGTGATGGCAAAGCAGCCGGGGCTCGACCGCGACGGGGTGAAGCTCAAGGAAGTGACGAT
GGACGTCTCGCTCTCGCACAGCTTCGCGGGCGAGCGCCGCCGCATCGCCTACGAGCGCCTGCTGCTCGATTTCATCGAGG
GCGACCAGACCCTCTTCGTGCGCCGCGACGAGGTCGAGGCGCAGTGGGAGTGGATCGACGCGATCCGCGATGCCTGGGAT
CAGGTCGACATGACACCGCAAAGCTACACCGCTGGAAGCTGGGGGCCGAGTTCGGCGATCGCGCTGATCGAGCGCGACGG
GGCGAGCTGGCATGATTGA

Upstream 100 bases:

>100_bases
CGGGCCGAAGGCGGCCGGAGGCCAGCCAATCTCCAGCCTTCGGAAAGGCCGAACGATAGCGGGAGATTGCTTCGTCGCCT
GCGGCTCCCCGCAATGACAT

Downstream 100 bases:

>100_bases
GCGCACCCCAAACCTTCTCCCCTTGGGGGAGAAGGATACGAAGCCTTGGCGCGCAGCGCCTGGGCGCAGTTGGATGAGGG
TCGCTGCCGTCGCTTTCGCC

Product: glucose-6-phosphate 1-dehydrogenase

Products: NA

Alternate protein names: G6PD [H]

Number of amino acids: Translated: 512; Mature: 512

Protein sequence:

>512_residues
MRLTYARCIRGAHPPLLSLLSKGTNVSVKVETLVLFGATGDLAQRMLFPSLYNLHMDGLLADALTIVGSGRSAMDRDAFR
AQVRAALTEYLPEDRIEAAVVDGFLARIDYCAIDAGAGTGYAELAALLGDRMARPIGVYLSTPPSMFGPIAQGLKAANIA
CAECRIAMEKPIGHDLASSREVNAQVGDAFAEDRVFRIDHYLGKETVQNLLALRFANMLFEPLWNAQAIDHVQITVAETV
GLEGRVSYYDGVGALKDMVQNHMLQLLAIIAMEPPASVGATAVRDEKVKLLRSLRKMTAEDVKAHSVKGQYSSGAVNGAA
VAGYADELGQPSNTETFVALKAFIDNWRWKGVPFYLRTGKRMPQRKSEVLIQFKPVPHNIFARVGAGKLDANMMIINLQP
EENIRVKVMAKQPGLDRDGVKLKEVTMDVSLSHSFAGERRRIAYERLLLDFIEGDQTLFVRRDEVEAQWEWIDAIRDAWD
QVDMTPQSYTAGSWGPSSAIALIERDGASWHD

Sequences:

>Translated_512_residues
MRLTYARCIRGAHPPLLSLLSKGTNVSVKVETLVLFGATGDLAQRMLFPSLYNLHMDGLLADALTIVGSGRSAMDRDAFR
AQVRAALTEYLPEDRIEAAVVDGFLARIDYCAIDAGAGTGYAELAALLGDRMARPIGVYLSTPPSMFGPIAQGLKAANIA
CAECRIAMEKPIGHDLASSREVNAQVGDAFAEDRVFRIDHYLGKETVQNLLALRFANMLFEPLWNAQAIDHVQITVAETV
GLEGRVSYYDGVGALKDMVQNHMLQLLAIIAMEPPASVGATAVRDEKVKLLRSLRKMTAEDVKAHSVKGQYSSGAVNGAA
VAGYADELGQPSNTETFVALKAFIDNWRWKGVPFYLRTGKRMPQRKSEVLIQFKPVPHNIFARVGAGKLDANMMIINLQP
EENIRVKVMAKQPGLDRDGVKLKEVTMDVSLSHSFAGERRRIAYERLLLDFIEGDQTLFVRRDEVEAQWEWIDAIRDAWD
QVDMTPQSYTAGSWGPSSAIALIERDGASWHD
>Mature_512_residues
MRLTYARCIRGAHPPLLSLLSKGTNVSVKVETLVLFGATGDLAQRMLFPSLYNLHMDGLLADALTIVGSGRSAMDRDAFR
AQVRAALTEYLPEDRIEAAVVDGFLARIDYCAIDAGAGTGYAELAALLGDRMARPIGVYLSTPPSMFGPIAQGLKAANIA
CAECRIAMEKPIGHDLASSREVNAQVGDAFAEDRVFRIDHYLGKETVQNLLALRFANMLFEPLWNAQAIDHVQITVAETV
GLEGRVSYYDGVGALKDMVQNHMLQLLAIIAMEPPASVGATAVRDEKVKLLRSLRKMTAEDVKAHSVKGQYSSGAVNGAA
VAGYADELGQPSNTETFVALKAFIDNWRWKGVPFYLRTGKRMPQRKSEVLIQFKPVPHNIFARVGAGKLDANMMIINLQP
EENIRVKVMAKQPGLDRDGVKLKEVTMDVSLSHSFAGERRRIAYERLLLDFIEGDQTLFVRRDEVEAQWEWIDAIRDAWD
QVDMTPQSYTAGSWGPSSAIALIERDGASWHD

Specific function: Pentose phosphate pathway; first step. [C]

COG id: COG0364

COG function: function code G; Glucose-6-phosphate 1-dehydrogenase

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the glucose-6-phosphate dehydrogenase family [H]

Homologues:

Organism=Homo sapiens, GI109389365, Length=487, Percent_Identity=36.3449691991786, Blast_Score=300, Evalue=2e-81,
Organism=Homo sapiens, GI108773793, Length=487, Percent_Identity=36.3449691991786, Blast_Score=300, Evalue=2e-81,
Organism=Homo sapiens, GI52145310, Length=509, Percent_Identity=27.8978388998035, Blast_Score=176, Evalue=7e-44,
Organism=Escherichia coli, GI1788158, Length=482, Percent_Identity=48.3402489626556, Blast_Score=467, Evalue=1e-133,
Organism=Caenorhabditis elegans, GI17538218, Length=507, Percent_Identity=34.9112426035503, Blast_Score=308, Evalue=4e-84,
Organism=Saccharomyces cerevisiae, GI6324088, Length=492, Percent_Identity=34.1463414634146, Blast_Score=268, Evalue=1e-72,
Organism=Drosophila melanogaster, GI24643350, Length=510, Percent_Identity=35.0980392156863, Blast_Score=302, Evalue=4e-82,
Organism=Drosophila melanogaster, GI24643352, Length=509, Percent_Identity=35.1669941060904, Blast_Score=301, Evalue=8e-82,
Organism=Drosophila melanogaster, GI221513548, Length=499, Percent_Identity=27.8557114228457, Blast_Score=182, Evalue=6e-46,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR001282
- InterPro:   IPR019796
- InterPro:   IPR022675
- InterPro:   IPR022674
- InterPro:   IPR016040 [H]

Pfam domain/function: PF02781 G6PD_C; PF00479 G6PD_N [H]

EC number: =1.1.1.49 [H]

Molecular weight: Translated: 56350; Mature: 56350

Theoretical pI: Translated: 6.37; Mature: 6.37

Prosite motif: PS00069 G6P_DEHYDROGENASE

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.8 %Cys     (Translated Protein)
3.5 %Met     (Translated Protein)
4.3 %Cys+Met (Translated Protein)
0.8 %Cys     (Mature Protein)
3.5 %Met     (Mature Protein)
4.3 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MRLTYARCIRGAHPPLLSLLSKGTNVSVKVETLVLFGATGDLAQRMLFPSLYNLHMDGLL
CCCCHHHHHCCCCCHHHHHHHCCCCEEEEEEEEEEECCCHHHHHHHHHHHHHHHHHHHHH
ADALTIVGSGRSAMDRDAFRAQVRAALTEYLPEDRIEAAVVDGFLARIDYCAIDAGAGTG
HHHHHHHCCCCCHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHEEECCCCCC
YAELAALLGDRMARPIGVYLSTPPSMFGPIAQGLKAANIACAECRIAMEKPIGHDLASSR
HHHHHHHHHHHHCCCEEEEEECCHHHHHHHHHHHHHCCEEHHHHHHHHCCCCCCCHHCCC
EVNAQVGDAFAEDRVFRIDHYLGKETVQNLLALRFANMLFEPLWNAQAIDHVQITVAETV
CCCHHHCCHHHHCCEEEHHHHHCHHHHHHHHHHHHHHHHHHHCCCCCCCCEEEEEEEHHC
GLEGRVSYYDGVGALKDMVQNHMLQLLAIIAMEPPASVGATAVRDEKVKLLRSLRKMTAE
CCCCEEEHHCCHHHHHHHHHHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHHHH
DVKAHSVKGQYSSGAVNGAAVAGYADELGQPSNTETFVALKAFIDNWRWKGVPFYLRTGK
HHHHHCCCCCCCCCCCCCCEEECCHHHCCCCCCCHHHHHHHHHHCCCCCCCCCEEEECCC
RMPQRKSEVLIQFKPVPHNIFARVGAGKLDANMMIINLQPEENIRVKVMAKQPGLDRDGV
CCCCCCCCEEEEEECCCHHHHHHCCCCEECCCEEEEEECCCCCCEEEEEEECCCCCCCCC
KLKEVTMDVSLSHSFAGERRRIAYERLLLDFIEGDQTLFVRRDEVEAQWEWIDAIRDAWD
EEEEEEEEEEECCHHCCHHHHHHHHHHHHHHHCCCCEEEEEECCCHHHHHHHHHHHHHHH
QVDMTPQSYTAGSWGPSSAIALIERDGASWHD
HCCCCCCCCCCCCCCCCCEEEEEEECCCCCCC
>Mature Secondary Structure
MRLTYARCIRGAHPPLLSLLSKGTNVSVKVETLVLFGATGDLAQRMLFPSLYNLHMDGLL
CCCCHHHHHCCCCCHHHHHHHCCCCEEEEEEEEEEECCCHHHHHHHHHHHHHHHHHHHHH
ADALTIVGSGRSAMDRDAFRAQVRAALTEYLPEDRIEAAVVDGFLARIDYCAIDAGAGTG
HHHHHHHCCCCCHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHEEECCCCCC
YAELAALLGDRMARPIGVYLSTPPSMFGPIAQGLKAANIACAECRIAMEKPIGHDLASSR
HHHHHHHHHHHHCCCEEEEEECCHHHHHHHHHHHHHCCEEHHHHHHHHCCCCCCCHHCCC
EVNAQVGDAFAEDRVFRIDHYLGKETVQNLLALRFANMLFEPLWNAQAIDHVQITVAETV
CCCHHHCCHHHHCCEEEHHHHHCHHHHHHHHHHHHHHHHHHHCCCCCCCCEEEEEEEHHC
GLEGRVSYYDGVGALKDMVQNHMLQLLAIIAMEPPASVGATAVRDEKVKLLRSLRKMTAE
CCCCEEEHHCCHHHHHHHHHHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHHHH
DVKAHSVKGQYSSGAVNGAAVAGYADELGQPSNTETFVALKAFIDNWRWKGVPFYLRTGK
HHHHHCCCCCCCCCCCCCCEEECCHHHCCCCCCCHHHHHHHHHHCCCCCCCCCEEEECCC
RMPQRKSEVLIQFKPVPHNIFARVGAGKLDANMMIINLQPEENIRVKVMAKQPGLDRDGV
CCCCCCCCEEEEEECCCHHHHHHCCCCEECCCEEEEEECCCCCCEEEEEEECCCCCCCCC
KLKEVTMDVSLSHSFAGERRRIAYERLLLDFIEGDQTLFVRRDEVEAQWEWIDAIRDAWD
EEEEEEEEEEECCHHCCHHHHHHHHHHHHHHHCCCCEEEEEECCCHHHHHHHHHHHHHHH
QVDMTPQSYTAGSWGPSSAIALIERDGASWHD
HCCCCCCCCCCCCCCCCCEEEEEEECCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 2254282 [H]