Definition Novosphingobium aromaticivorans DSM 12444 chromosome, complete genome.
Accession NC_007794
Length 3,561,584

Click here to switch to the map view.

The map label for this gene is pgk

Identifier: 87199982

GI number: 87199982

Start: 2083063

End: 2084250

Strand: Reverse

Name: pgk

Synonym: Saro_1965

Alternate gene names: 87199982

Gene position: 2084250-2083063 (Counterclockwise)

Preceding gene: 87199983

Following gene: 87199981

Centisome position: 58.52

GC content: 64.14

Gene sequence:

>1188_bases
ATGAGCTTCAAGACCCTTGACGACATCGGCGACCTGACCGGCAAGACCGTGCTGGTGCGCGAGGACCTCAACGTGCCGAT
GCAGGACGGCGCGGTCACCGACGACACGCGTCTGCGCGCCACCATCGCGACGCTGAACGAGCTGTCCGACAAGGGCGCGA
AGGTGCTCGTGCTGGCGCACTTTGGCCGCCCCAAGGGCCAGCCGTCGGAAGAATTTTCTTTGAAGAAGCTCGCTGCCCCG
CTCGCGCACGTACTGGGCCGTCCGGTCAGCTACATCGACTGGGAAAGCGACAAGGCCGCTGTGGCTGCTCTGACGCCCGG
TGCGATTGCCGTGCTTGAGAACACCCGCTTCTTCGACGGCGAGGAAAAGAACGACCCAGCCGTGATCGAGCGTTTCGCCA
GCCTCGGCGACATTTACGTCAATGATGCCTTTTCCGCCGCCCACCGCGCCCACGCTTCGACCGAAGGCCTGGCACACGTG
CTGCCGGCCTATGCAGGCCGCGCCATGGAGGCCGAGCTCAAGGCATTGCAGAAGGCGTTGGGGGAACCCGAACGTCCGGT
GGCAGCCGTTGTTGGCGGGGCCAAGGTGTCGACCAAGCTCGACGTGCTCAAGCACCTTGTCAGCAAGGTCGATCACCTGA
TCATCGGTGGTGGCATGGCCAACACGTTCCTTGCGGCGCGCGGCGTGAACGTGGGCAAGTCGCTGTGCGAACACGACCTT
ACCGGCACCGCCGAGGAAATTCTCGACAATGCCGACAAGTCGGGCTGCACCGTTCACCTGCCGTACGACGTGGTCGTTTC
GAAGGAGTTCACCGCAAACCCGCCGAGCCTGCGGACCTGCAATGTTCATGAGGTCGCTGCAGACGAGATGATCCTCGACG
TGGGCCCGGCCGCGGTCGAGGCGCTTGCTGATGTGCTCAAGACCTGCAAGACGCTGGTGTGGAACGGTCCGATGGGGGCG
TTCGAGACCGAGCCGTTCGACGCCGCCACCGTGGCGTTGGCGCGCACGGCTGCAGCTCTGACCAAGGAAGGTTCACTCGT
GTCGGTGGCGGGCGGGGGCGATACCGTGGCTGCCCTGAACCATGCGGGCGTGGTTGGTGATTTCTCTTACATCTCGACTG
CAGGCGGCGCCTTCCTTGAGTGGATGGAAGGAAAGGAATTGCCCGGCGTCGCGGCGCTGGAAGGATAG

Upstream 100 bases:

>100_bases
GCCTGAAACTCGCGCTGATGCTTGACTGGCGCGGCGGTGTGCTCGGCCGGGTCCTGACAGATGGCGAGATCGCCATCGGC
GACGAAGTGAGGATCGAGGA

Downstream 100 bases:

>100_bases
AGGTCGGGATAAAAATTTCGAGGCGCGTGTTGCACTGCGGCACGCGCCTTATTATGGCGTTTCCTCGCATAGGTATGCGC
CATTCCAGACGCCCGGTTGG

Product: phosphoglycerate kinase

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 395; Mature: 394

Protein sequence:

>395_residues
MSFKTLDDIGDLTGKTVLVREDLNVPMQDGAVTDDTRLRATIATLNELSDKGAKVLVLAHFGRPKGQPSEEFSLKKLAAP
LAHVLGRPVSYIDWESDKAAVAALTPGAIAVLENTRFFDGEEKNDPAVIERFASLGDIYVNDAFSAAHRAHASTEGLAHV
LPAYAGRAMEAELKALQKALGEPERPVAAVVGGAKVSTKLDVLKHLVSKVDHLIIGGGMANTFLAARGVNVGKSLCEHDL
TGTAEEILDNADKSGCTVHLPYDVVVSKEFTANPPSLRTCNVHEVAADEMILDVGPAAVEALADVLKTCKTLVWNGPMGA
FETEPFDAATVALARTAAALTKEGSLVSVAGGGDTVAALNHAGVVGDFSYISTAGGAFLEWMEGKELPGVAALEG

Sequences:

>Translated_395_residues
MSFKTLDDIGDLTGKTVLVREDLNVPMQDGAVTDDTRLRATIATLNELSDKGAKVLVLAHFGRPKGQPSEEFSLKKLAAP
LAHVLGRPVSYIDWESDKAAVAALTPGAIAVLENTRFFDGEEKNDPAVIERFASLGDIYVNDAFSAAHRAHASTEGLAHV
LPAYAGRAMEAELKALQKALGEPERPVAAVVGGAKVSTKLDVLKHLVSKVDHLIIGGGMANTFLAARGVNVGKSLCEHDL
TGTAEEILDNADKSGCTVHLPYDVVVSKEFTANPPSLRTCNVHEVAADEMILDVGPAAVEALADVLKTCKTLVWNGPMGA
FETEPFDAATVALARTAAALTKEGSLVSVAGGGDTVAALNHAGVVGDFSYISTAGGAFLEWMEGKELPGVAALEG
>Mature_394_residues
SFKTLDDIGDLTGKTVLVREDLNVPMQDGAVTDDTRLRATIATLNELSDKGAKVLVLAHFGRPKGQPSEEFSLKKLAAPL
AHVLGRPVSYIDWESDKAAVAALTPGAIAVLENTRFFDGEEKNDPAVIERFASLGDIYVNDAFSAAHRAHASTEGLAHVL
PAYAGRAMEAELKALQKALGEPERPVAAVVGGAKVSTKLDVLKHLVSKVDHLIIGGGMANTFLAARGVNVGKSLCEHDLT
GTAEEILDNADKSGCTVHLPYDVVVSKEFTANPPSLRTCNVHEVAADEMILDVGPAAVEALADVLKTCKTLVWNGPMGAF
ETEPFDAATVALARTAAALTKEGSLVSVAGGGDTVAALNHAGVVGDFSYISTAGGAFLEWMEGKELPGVAALEG

Specific function: Second phase of glycolysis; second step. [C]

COG id: COG0126

COG function: function code G; 3-phosphoglycerate kinase

Gene ontology:

Cell location: Cytoplasm (Potential)

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the phosphoglycerate kinase family

Homologues:

Organism=Homo sapiens, GI4505763, Length=411, Percent_Identity=38.1995133819951, Blast_Score=252, Evalue=3e-67,
Organism=Homo sapiens, GI31543397, Length=412, Percent_Identity=38.5922330097087, Blast_Score=246, Evalue=2e-65,
Organism=Escherichia coli, GI1789294, Length=397, Percent_Identity=47.3551637279597, Blast_Score=323, Evalue=1e-89,
Organism=Caenorhabditis elegans, GI17508823, Length=404, Percent_Identity=39.8514851485149, Blast_Score=270, Evalue=1e-72,
Organism=Saccharomyces cerevisiae, GI6319857, Length=403, Percent_Identity=37.468982630273, Blast_Score=239, Evalue=4e-64,
Organism=Drosophila melanogaster, GI17136394, Length=403, Percent_Identity=38.4615384615385, Blast_Score=250, Evalue=1e-66,
Organism=Drosophila melanogaster, GI24581203, Length=404, Percent_Identity=37.3762376237624, Blast_Score=248, Evalue=4e-66,

Paralogues:

None

Copy number: 2990 Molecules/Cell In: Growth Phase, Minimal Media (Based on E. coli). 1460 Molecules/Cell In: Stationary-Phase, Rich-Media (Based on E. coli). [C]

Swissprot (AC and ID): PGK_NOVAD (Q2G6W8)

Other databases:

- EMBL:   CP000248
- RefSeq:   YP_497239.1
- ProteinModelPortal:   Q2G6W8
- SMR:   Q2G6W8
- STRING:   Q2G6W8
- GeneID:   3917281
- GenomeReviews:   CP000248_GR
- KEGG:   nar:Saro_1965
- NMPDR:   fig|48935.1.peg.2673
- eggNOG:   COG0126
- HOGENOM:   HBG453500
- OMA:   NCAIILP
- PhylomeDB:   Q2G6W8
- ProtClustDB:   PRK00073
- BioCyc:   NARO279238:SARO_1965-MONOMER
- GO:   GO:0005737
- GO:   GO:0006096
- HAMAP:   MF_00145
- InterPro:   IPR001576
- InterPro:   IPR015901
- InterPro:   IPR015911
- InterPro:   IPR015824
- Gene3D:   G3DSA:3.40.50.1270
- Gene3D:   G3DSA:3.40.50.1260
- PANTHER:   PTHR11406
- PIRSF:   PIRSF000724
- PRINTS:   PR00477

Pfam domain/function: PF00162 PGK; SSF53748 PGK

EC number: =2.7.2.3

Molecular weight: Translated: 41301; Mature: 41170

Theoretical pI: Translated: 4.76; Mature: 4.76

Prosite motif: PS00111 PGLYCERATE_KINASE

Important sites: BINDING 37-37 BINDING 116-116 BINDING 149-149 BINDING 199-199 BINDING 322-322

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.0 %Cys     (Translated Protein)
1.8 %Met     (Translated Protein)
2.8 %Cys+Met (Translated Protein)
1.0 %Cys     (Mature Protein)
1.5 %Met     (Mature Protein)
2.5 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSFKTLDDIGDLTGKTVLVREDLNVPMQDGAVTDDTRLRATIATLNELSDKGAKVLVLAH
CCCCCHHHHHHCCCCEEEEEECCCCCCCCCCCCCCHHHHHHHHHHHHHCCCCCEEEEEEE
FGRPKGQPSEEFSLKKLAAPLAHVLGRPVSYIDWESDKAAVAALTPGAIAVLENTRFFDG
CCCCCCCCCHHHHHHHHHHHHHHHHCCCCEEEECCCCCCEEEEECCCEEEEEECCEECCC
EEKNDPAVIERFASLGDIYVNDAFSAAHRAHASTEGLAHVLPAYAGRAMEAELKALQKAL
CCCCCHHHHHHHHHHCCEEECHHHHHHHHHHCCHHHHHHHHHHHCCCHHHHHHHHHHHHH
GEPERPVAAVVGGAKVSTKLDVLKHLVSKVDHLIIGGGMANTFLAARGVNVGKSLCEHDL
CCCCCCCEEEECCCHHHHHHHHHHHHHHHHHHEEECCCHHHHHHHHCCCHHHHHHHHHCC
TGTAEEILDNADKSGCTVHLPYDVVVSKEFTANPPSLRTCNVHEVAADEMILDVGPAAVE
CCCHHHHHCCCCCCCCEEECCCEEEEECCCCCCCCCCEECCHHHHHHHHHEEECCHHHHH
ALADVLKTCKTLVWNGPMGAFETEPFDAATVALARTAAALTKEGSLVSVAGGGDTVAALN
HHHHHHHHHHHHEECCCCCCCCCCCCHHHHHHHHHHHHHHHCCCCEEEEECCCCEEEEHH
HAGVVGDFSYISTAGGAFLEWMEGKELPGVAALEG
CCCCEECHHHHHHCCHHHHHHHCCCCCCCCCCCCC
>Mature Secondary Structure 
SFKTLDDIGDLTGKTVLVREDLNVPMQDGAVTDDTRLRATIATLNELSDKGAKVLVLAH
CCCCHHHHHHCCCCEEEEEECCCCCCCCCCCCCCHHHHHHHHHHHHHCCCCCEEEEEEE
FGRPKGQPSEEFSLKKLAAPLAHVLGRPVSYIDWESDKAAVAALTPGAIAVLENTRFFDG
CCCCCCCCCHHHHHHHHHHHHHHHHCCCCEEEECCCCCCEEEEECCCEEEEEECCEECCC
EEKNDPAVIERFASLGDIYVNDAFSAAHRAHASTEGLAHVLPAYAGRAMEAELKALQKAL
CCCCCHHHHHHHHHHCCEEECHHHHHHHHHHCCHHHHHHHHHHHCCCHHHHHHHHHHHHH
GEPERPVAAVVGGAKVSTKLDVLKHLVSKVDHLIIGGGMANTFLAARGVNVGKSLCEHDL
CCCCCCCEEEECCCHHHHHHHHHHHHHHHHHHEEECCCHHHHHHHHCCCHHHHHHHHHCC
TGTAEEILDNADKSGCTVHLPYDVVVSKEFTANPPSLRTCNVHEVAADEMILDVGPAAVE
CCCHHHHHCCCCCCCCEEECCCEEEEECCCCCCCCCCEECCHHHHHHHHHEEECCHHHHH
ALADVLKTCKTLVWNGPMGAFETEPFDAATVALARTAAALTKEGSLVSVAGGGDTVAALN
HHHHHHHHHHHHEECCCCCCCCCCCCHHHHHHHHHHHHHHHCCCCEEEEECCCCEEEEHH
HAGVVGDFSYISTAGGAFLEWMEGKELPGVAALEG
CCCCEECHHHHHHCCHHHHHHHCCCCCCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA