| Definition | Geobacter sulfurreducens PCA chromosome, complete genome. |
|---|---|
| Accession | NC_002939 |
| Length | 3,814,139 |
Click here to switch to the map view.
The map label for this gene is pgk [H]
Identifier: 39996728
GI number: 39996728
Start: 1782373
End: 1784337
Strand: Reverse
Name: pgk [H]
Synonym: GSU1628
Alternate gene names: 39996728
Gene position: 1784337-1782373 (Counterclockwise)
Preceding gene: 39996729
Following gene: 39996727
Centisome position: 46.78
GC content: 57.71
Gene sequence:
>1965_bases ATGGCAATCCGCTATATTGACGAAATATCCGAACTCAAAGACAAAAAGGTCTTCATCAGGGTCGACTTCAACGTTCCCTT GGATGAACATCAGAACATCACTGAAGACACGCGCATCAGGGCGGTCCTCCCTACGATCAACTTTGCCCTCGATGCCGGCG CGAAAGTGGTTCTCGCCTCTCACCTGGGACGCCCAAAGGGAGAGCGCAAGCCCAAGTATTCCATGGCCCCGGCGGCAAAG CGTCTCTCGCGGCTTCTGGGCAAAGAGGTACTCTTGGCGCCCGACTGCATCGGCAGCGAAGTACGGCAGATGATCGATGC CATGAAATCCGGCGACATCATCATGCTGGAAAACGTGCGCTTTTATGAAGGTGAGGAGAAAAATGACGAAAACTTTGCCC GAGAACTGGCCAACGGCTGTGAGATCTACGTAAACGATGCCTTTGCCGTCTCACACCGGGCTCATGCGTCGGTTGAAGCG ATAACAAAGTTCTTTCCGGTAGTTGCGGCCGGATTTCTCATGAAGAACGAGATGAATTATTTCGAAAAGGCGATGCAAAA GCCGATTCGCCCCCTGGTCGCTATCTTGGGCGGGGCCAAAGTCTCGGGCAAACTGGAAGTTCTCGAAAGCCTTCTCAACA AGGTGGACAAAATCATCATCGGCGGCGGCATGGCATTCACCTTTCTGAAGGCCCTCGGCTACAACGTGGGCAAGTCGCTG GTGGAGGAAGACCTGATCGAAACGGCCCGCTCAACCTACGCCAAAGCCCGTGAAAAGGGAATCAAGTTCTATCTCCCCGT TGATTGCGTGGCTGCCGATCGATTCAACCCCGAGGCCGAGACCAAGGTAACCACCATTCAGGAAATCCCCGAAGAGTGGA TGGCTCTCGATATCGGTCCTGCCACGGTTGCCCTCTTCACCGAGGCACTCCAGAGCGCCAAGACCATCATCTGGAACGGT CCCATGGGGGTTTTCGAGATGGATGCCTTCTCCCGCGGCACCTTTGCCATGGTGACTGCCGTGGCCAACTCCTACGCCCT TACCATCGTCGGCGGCGGCGACACCGACTCTGCGGTCCACCGCGCCGGCGAATATGCCAAGATCAGCTACATCTCCACCG GCGGCGGCGCTTTCCTTGAGCTCCTCGAAGGCAAGAAACTTCCCCGGCATCAAGGTGCTGGAAGAAAACGGAAAATAGGA GGAGCGGCCATGAGAACACCTGTGATTGCAGGAAACTGGAAGCTGTTCAAAAAACGCGCCGAGGCCCGTGAGCTGGTCAA TGGACTTGTTTCCCTGGTGAAGGACGTCCAGGGGGTCGAAATCGTCGTAGCTCCGGTCTTCACCGTACTGGCCGCCGTAA AGGGCGCCCTGGACGGCTCAGCCATCAAGCTCGCTGGCCAGGACTGCTTCTGGGAAGAGGAAGGGGCTTACACCGGCGAG ATTTCCCCGGGCATGCTCGTGGATGCCGGATGCAGCCACGTCATTATCGGCCATTCGGAGCGCCGTCAGTATTTCGGCGA AACTGATGAAACCGTGAATCGTAAGATCAAGGCCGCCCTCAAAGCAGGACTCGCGGCCATTGCCTGCATCGGAGAATCCC TGGCAGAGCGCGAAGCAGGCACGACGTTCGACGTGCTGCGGACGCAGCTGAACGGCGGACTGGCCGGGCTATCCGCCGAC GACCTCAAAGACGTCATCATCGCCTATGAGCCGGTATGGGCCATAGGCACCGGAAAAACCGCCACGGACGCCCAAGCCCA GGAGGCTCACGCCTTCATCAGAGGGGTGGTGTCCGAACTTCTCGGCAAACCGGCAGCAGAGGCGGTTCGCATCCTTTACG GGGGCAGCGTAAAGCCAGAGAACATCAAGGGGCTCATGACCCAACCCGATATCGACGGCGCCCTGGTGGGAGGAGCCAGC CTCAAGGCGGACTCTTTTGCGGCGATTGCCTCGTTCAGCATGTAA
Upstream 100 bases:
>100_bases TACGCGCAAAAGGGGGGATCAATCCCCCCTTTTCTTTTTGCCCGCCAGTCGAACCGATCCCGCCCCTGCATTGCTGACAC TATCTACTCGGGAGGAAACC
Downstream 100 bases:
>100_bases ACACGAAAGAACGCCAAGTTAGGACTTGGCTTTTCAACTAACCTGTGGTATGGATTGCAGGTTACTACATACAGTGGAGT TGGCATTATGATGATCTTTT
Product: bifunctional phosphoglycerate kinase/triosephosphate isomerase
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 654; Mature: 653
Protein sequence:
>654_residues MAIRYIDEISELKDKKVFIRVDFNVPLDEHQNITEDTRIRAVLPTINFALDAGAKVVLASHLGRPKGERKPKYSMAPAAK RLSRLLGKEVLLAPDCIGSEVRQMIDAMKSGDIIMLENVRFYEGEEKNDENFARELANGCEIYVNDAFAVSHRAHASVEA ITKFFPVVAAGFLMKNEMNYFEKAMQKPIRPLVAILGGAKVSGKLEVLESLLNKVDKIIIGGGMAFTFLKALGYNVGKSL VEEDLIETARSTYAKAREKGIKFYLPVDCVAADRFNPEAETKVTTIQEIPEEWMALDIGPATVALFTEALQSAKTIIWNG PMGVFEMDAFSRGTFAMVTAVANSYALTIVGGGDTDSAVHRAGEYAKISYISTGGGAFLELLEGKKLPRHQGAGRKRKIG GAAMRTPVIAGNWKLFKKRAEARELVNGLVSLVKDVQGVEIVVAPVFTVLAAVKGALDGSAIKLAGQDCFWEEEGAYTGE ISPGMLVDAGCSHVIIGHSERRQYFGETDETVNRKIKAALKAGLAAIACIGESLAEREAGTTFDVLRTQLNGGLAGLSAD DLKDVIIAYEPVWAIGTGKTATDAQAQEAHAFIRGVVSELLGKPAAEAVRILYGGSVKPENIKGLMTQPDIDGALVGGAS LKADSFAAIASFSM
Sequences:
>Translated_654_residues MAIRYIDEISELKDKKVFIRVDFNVPLDEHQNITEDTRIRAVLPTINFALDAGAKVVLASHLGRPKGERKPKYSMAPAAK RLSRLLGKEVLLAPDCIGSEVRQMIDAMKSGDIIMLENVRFYEGEEKNDENFARELANGCEIYVNDAFAVSHRAHASVEA ITKFFPVVAAGFLMKNEMNYFEKAMQKPIRPLVAILGGAKVSGKLEVLESLLNKVDKIIIGGGMAFTFLKALGYNVGKSL VEEDLIETARSTYAKAREKGIKFYLPVDCVAADRFNPEAETKVTTIQEIPEEWMALDIGPATVALFTEALQSAKTIIWNG PMGVFEMDAFSRGTFAMVTAVANSYALTIVGGGDTDSAVHRAGEYAKISYISTGGGAFLELLEGKKLPRHQGAGRKRKIG GAAMRTPVIAGNWKLFKKRAEARELVNGLVSLVKDVQGVEIVVAPVFTVLAAVKGALDGSAIKLAGQDCFWEEEGAYTGE ISPGMLVDAGCSHVIIGHSERRQYFGETDETVNRKIKAALKAGLAAIACIGESLAEREAGTTFDVLRTQLNGGLAGLSAD DLKDVIIAYEPVWAIGTGKTATDAQAQEAHAFIRGVVSELLGKPAAEAVRILYGGSVKPENIKGLMTQPDIDGALVGGAS LKADSFAAIASFSM >Mature_653_residues AIRYIDEISELKDKKVFIRVDFNVPLDEHQNITEDTRIRAVLPTINFALDAGAKVVLASHLGRPKGERKPKYSMAPAAKR LSRLLGKEVLLAPDCIGSEVRQMIDAMKSGDIIMLENVRFYEGEEKNDENFARELANGCEIYVNDAFAVSHRAHASVEAI TKFFPVVAAGFLMKNEMNYFEKAMQKPIRPLVAILGGAKVSGKLEVLESLLNKVDKIIIGGGMAFTFLKALGYNVGKSLV EEDLIETARSTYAKAREKGIKFYLPVDCVAADRFNPEAETKVTTIQEIPEEWMALDIGPATVALFTEALQSAKTIIWNGP MGVFEMDAFSRGTFAMVTAVANSYALTIVGGGDTDSAVHRAGEYAKISYISTGGGAFLELLEGKKLPRHQGAGRKRKIGG AAMRTPVIAGNWKLFKKRAEARELVNGLVSLVKDVQGVEIVVAPVFTVLAAVKGALDGSAIKLAGQDCFWEEEGAYTGEI SPGMLVDAGCSHVIIGHSERRQYFGETDETVNRKIKAALKAGLAAIACIGESLAEREAGTTFDVLRTQLNGGLAGLSADD LKDVIIAYEPVWAIGTGKTATDAQAQEAHAFIRGVVSELLGKPAAEAVRILYGGSVKPENIKGLMTQPDIDGALVGGASL KADSFAAIASFSM
Specific function: Second phase of glycolysis; second step. [C]
COG id: COG0126
COG function: function code G; 3-phosphoglycerate kinase
Gene ontology:
Cell location: Cytoplasm (Potential) [H]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the phosphoglycerate kinase family [H]
Homologues:
Organism=Homo sapiens, GI4505763, Length=400, Percent_Identity=47, Blast_Score=347, Evalue=2e-95, Organism=Homo sapiens, GI31543397, Length=400, Percent_Identity=43.75, Blast_Score=334, Evalue=2e-91, Organism=Homo sapiens, GI226529917, Length=273, Percent_Identity=43.956043956044, Blast_Score=207, Evalue=2e-53, Organism=Homo sapiens, GI4507645, Length=246, Percent_Identity=46.3414634146341, Blast_Score=203, Evalue=5e-52, Organism=Escherichia coli, GI1789294, Length=380, Percent_Identity=44.7368421052632, Blast_Score=310, Evalue=2e-85, Organism=Escherichia coli, GI1790353, Length=246, Percent_Identity=47.1544715447154, Blast_Score=206, Evalue=3e-54, Organism=Caenorhabditis elegans, GI17508823, Length=404, Percent_Identity=46.7821782178218, Blast_Score=345, Evalue=4e-95, Organism=Caenorhabditis elegans, GI17536593, Length=244, Percent_Identity=47.1311475409836, Blast_Score=198, Evalue=8e-51, Organism=Saccharomyces cerevisiae, GI6319857, Length=398, Percent_Identity=48.4924623115578, Blast_Score=353, Evalue=5e-98, Organism=Saccharomyces cerevisiae, GI6320255, Length=247, Percent_Identity=41.7004048582996, Blast_Score=175, Evalue=2e-44, Organism=Drosophila melanogaster, GI24581203, Length=396, Percent_Identity=44.9494949494949, Blast_Score=320, Evalue=1e-87, Organism=Drosophila melanogaster, GI17136394, Length=399, Percent_Identity=44.8621553884712, Blast_Score=315, Evalue=5e-86, Organism=Drosophila melanogaster, GI28572004, Length=240, Percent_Identity=45.8333333333333, Blast_Score=195, Evalue=8e-50, Organism=Drosophila melanogaster, GI28572008, Length=240, Percent_Identity=45.8333333333333, Blast_Score=194, Evalue=2e-49, Organism=Drosophila melanogaster, GI28572006, Length=240, Percent_Identity=45.8333333333333, Blast_Score=194, Evalue=2e-49,
Paralogues:
None
Copy number: 2990 Molecules/Cell In: Growth Phase, Minimal Media (Based on E. coli). 1460 Molecules/Cell In: Stationary-Phase, Rich-Media (Based on E. coli). [C]
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR001576 - InterPro: IPR015901 - InterPro: IPR015911 - InterPro: IPR015824 [H]
Pfam domain/function: PF00162 PGK [H]
EC number: =2.7.2.3 [H]
Molecular weight: Translated: 70341; Mature: 70210
Theoretical pI: Translated: 6.29; Mature: 6.29
Prosite motif: PS00111 PGLYCERATE_KINASE ; PS00171 TIM
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.9 %Cys (Translated Protein) 2.6 %Met (Translated Protein) 3.5 %Cys+Met (Translated Protein) 0.9 %Cys (Mature Protein) 2.5 %Met (Mature Protein) 3.4 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MAIRYIDEISELKDKKVFIRVDFNVPLDEHQNITEDTRIRAVLPTINFALDAGAKVVLAS CCCHHHHHHHHCCCCEEEEEEECCCCCCCCCCCCCCCEEEEEECHHHHHHCCCCHHHHHH HLGRPKGERKPKYSMAPAAKRLSRLLGKEVLLAPDCIGSEVRQMIDAMKSGDIIMLENVR HCCCCCCCCCCCCCCCHHHHHHHHHHCCCEEECCHHCCHHHHHHHHHHCCCCEEEEECEE FYEGEEKNDENFARELANGCEIYVNDAFAVSHRAHASVEAITKFFPVVAAGFLMKNEMNY EECCCCCCHHHHHHHHCCCCEEEEECCEEECHHHHHHHHHHHHHHHHHHHHHHHHHHHHH FEKAMQKPIRPLVAILGGAKVSGKLEVLESLLNKVDKIIIGGGMAFTFLKALGYNVGKSL HHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHEEECCCHHHHHHHHHHHHHHHHH VEEDLIETARSTYAKAREKGIKFYLPVDCVAADRFNPEAETKVTTIQEIPEEWMALDIGP HHHHHHHHHHHHHHHHHHCCCEEEECCEEEECCCCCCCCHHHHHHHHHCCHHHHEEECCH ATVALFTEALQSAKTIIWNGPMGVFEMDAFSRGTFAMVTAVANSYALTIVGGGDTDSAVH HHHHHHHHHHHHCCEEEECCCCCEEEECCCCCCHHHHHHHHHCCEEEEEEECCCCHHHHH RAGEYAKISYISTGGGAFLELLEGKKLPRHQGAGRKRKIGGAAMRTPVIAGNWKLFKKRA HCCCCEEEEEEECCCHHHHHHHCCCCCCCCCCCCCCCCCCCHHHCCCEEECCHHHHHHHH EARELVNGLVSLVKDVQGVEIVVAPVFTVLAAVKGALDGSAIKLAGQDCFWEEEGAYTGE HHHHHHHHHHHHHHHCCCCEEHHHHHHHHHHHHHHCCCCCEEEEECCCCCCCCCCCEECC ISPGMLVDAGCSHVIIGHSERRQYFGETDETVNRKIKAALKAGLAAIACIGESLAEREAG CCCCEEEECCCCEEEECCHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCC TTFDVLRTQLNGGLAGLSADDLKDVIIAYEPVWAIGTGKTATDAQAQEAHAFIRGVVSEL CHHHHHHHHHCCCCCCCCHHHHHHHHEEECCEEEECCCCCCCCHHHHHHHHHHHHHHHHH LGKPAAEAVRILYGGSVKPENIKGLMTQPDIDGALVGGASLKADSFAAIASFSM HCCCHHHHHHHHCCCCCCCCCCCCCCCCCCCCCEEECCCCCCCCCHHHHHCCCC >Mature Secondary Structure AIRYIDEISELKDKKVFIRVDFNVPLDEHQNITEDTRIRAVLPTINFALDAGAKVVLAS CCHHHHHHHHCCCCEEEEEEECCCCCCCCCCCCCCCEEEEEECHHHHHHCCCCHHHHHH HLGRPKGERKPKYSMAPAAKRLSRLLGKEVLLAPDCIGSEVRQMIDAMKSGDIIMLENVR HCCCCCCCCCCCCCCCHHHHHHHHHHCCCEEECCHHCCHHHHHHHHHHCCCCEEEEECEE FYEGEEKNDENFARELANGCEIYVNDAFAVSHRAHASVEAITKFFPVVAAGFLMKNEMNY EECCCCCCHHHHHHHHCCCCEEEEECCEEECHHHHHHHHHHHHHHHHHHHHHHHHHHHHH FEKAMQKPIRPLVAILGGAKVSGKLEVLESLLNKVDKIIIGGGMAFTFLKALGYNVGKSL HHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHEEECCCHHHHHHHHHHHHHHHHH VEEDLIETARSTYAKAREKGIKFYLPVDCVAADRFNPEAETKVTTIQEIPEEWMALDIGP HHHHHHHHHHHHHHHHHHCCCEEEECCEEEECCCCCCCCHHHHHHHHHCCHHHHEEECCH ATVALFTEALQSAKTIIWNGPMGVFEMDAFSRGTFAMVTAVANSYALTIVGGGDTDSAVH HHHHHHHHHHHHCCEEEECCCCCEEEECCCCCCHHHHHHHHHCCEEEEEEECCCCHHHHH RAGEYAKISYISTGGGAFLELLEGKKLPRHQGAGRKRKIGGAAMRTPVIAGNWKLFKKRA HCCCCEEEEEEECCCHHHHHHHCCCCCCCCCCCCCCCCCCCHHHCCCEEECCHHHHHHHH EARELVNGLVSLVKDVQGVEIVVAPVFTVLAAVKGALDGSAIKLAGQDCFWEEEGAYTGE HHHHHHHHHHHHHHHCCCCEEHHHHHHHHHHHHHHCCCCCEEEEECCCCCCCCCCCEECC ISPGMLVDAGCSHVIIGHSERRQYFGETDETVNRKIKAALKAGLAAIACIGESLAEREAG CCCCEEEECCCCEEEECCHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCC TTFDVLRTQLNGGLAGLSADDLKDVIIAYEPVWAIGTGKTATDAQAQEAHAFIRGVVSEL CHHHHHHHHHCCCCCCCCHHHHHHHHEEECCEEEECCCCCCCCHHHHHHHHHHHHHHHHH LGKPAAEAVRILYGGSVKPENIKGLMTQPDIDGALVGGASLKADSFAAIASFSM HCCCHHHHHHHHCCCCCCCCCCCCCCCCCCCCCEEECCCCCCCCCHHHHHCCCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: NA