| Definition | Escherichia coli O157:H7 str. EC4115, complete genome. |
|---|---|
| Accession | NC_011353 |
| Length | 5,572,075 |
Click here to switch to the map view.
The map label for this gene is glpK [H]
Identifier: 209398014
GI number: 209398014
Start: 4459820
End: 4461328
Strand: Direct
Name: glpK [H]
Synonym: ECH74115_4826
Alternate gene names: 209398014
Gene position: 4459820-4461328 (Clockwise)
Preceding gene: 209397224
Following gene: 209396982
Centisome position: 80.04
GC content: 54.34
Gene sequence:
>1509_bases ATGCCTGATAACAGCGCAGCTATCGTTATCGATATTGGCACCACCAATTGCAAAGTCACCTGCTTTTCCTGCCTGGACGC AACGACGTTGGGCGCGCATAAATTCGTGACGGCAAAGCAGATCTCCCCACAGGGCGATGTCGATTTCGATATCGACGCCC TCTGGCAGGAGGTCCGCCAGGCGATAGCGCAACTGAACGCCGCTTCGCCGCTGCCAGTCAGACGGATCAGCATTGCCAGT TTTGGCGAATCAGGCGTGTTCCTTGACGAGCATGGCGAGATCCTGACGCCAATGCTGGCATGGTATGACCGTCGCGGTGA AGAGTATCTGGCAACGCTTAGCGAGGCAGACAGTGCGGCACTTTATGACATCTGCGGTCTACCACTACACAGCAATTACT CTGCCTTCAAAATGCGCTGGTTGCTGGAACATTACCCGCTGCGTAATCGCCGCGGCCTGCGCTGGCTACATGCGCCGGAA GTGCTGCTCTGGCGGCTGACTGGCGAACAGCACACGGATATCACCTTAGCCAGCCGCACGCTGTGTCTGGACGTGCGCAA AGGCGAATGGTCAGCGAAAGCGGCGGCGTTGTTACACGTTCCCTGTACGGCATTTGCGCCATTGGTGCAGCCAGGCGAGC ACGCCGGATGGGTCAGCGAGTCACTTTGCAAGACGCTTGGGTTCTCGCAACCGGTCAGCGTGACGCTGGCCGGACATGAC CATATGGTGGGTGCGCGAGCGTTGCAGATGATGCCAGGCGATATCCTTAACTCGACGGGGACCACGGAAGGCATTCTGCA ACTGGATACACAACCGACGCTGGATGAACAGGCCAAACGTGACAAGCTGGCAAACGGCTGTTACTCACTTGCCAACCAGT TCACCCTGTTTGCGTCGCTGCCCGTGGGCGGTTTCGCGCTGGAGTGGCTGCGCAACACGTTCCGGCTAACCGATGAGGAG ATCGCCGCATCACTTACTCGCGGACATGCTGATTATCTGGCGGGGAATTGGTTGCTCGATGACATTCCCGTCTTTATTCC ACATCTTCGCGGTTCGGGTTCGCCCTATAAAAATCGCCATACCCGTGGATTATTTTATGGGCTTGGCGATACGTTAAGTA TCGACATGTTAATTGCCAGCGTATCACTGGGATTAACCATGGAATTTGCCAACTGCTTCGCCTGTTTTAACGTGCCTGGC ACCAGCGCGTTAAAAGTGATCGGTCCGGCAACCCATAATCCTCTTTGGCTGCAATTAAAGGCGGATATTTTACAGCGTCC GGTTGAAGCAATTGCATTTAACGAGGCGGTTTCTGTCGGAGCATTATTAACCGCCGCACCGGATATTCCACCGCCGCCAG TCGCTATAGCCCAACGTTTGTTACCGAATCGGGCGAGATACCATCAATTACAGCGTTATCAGCACAAATGGAAAAGCTGG TATCAGTTGAAATTACAACAAGAAGGCGTGATGCCATTACATCATCGAGAGGAACACTATGTTGAATAA
Upstream 100 bases:
>100_bases CTGCTGGAAATCTTCAACGGCAATCTCATCGCCATTGGTCTGGTGCCGGTTATCGCCCTGGTACTGTATGGCATTTTCCG AATGACGCGGAGCACGGTTT
Downstream 100 bases:
>100_bases AACCGTGGAGGTCAGAAACAGTACTGGCCTGCATGCACGTCCGGCGGCCTGTCTGGCGAAAGCCGCCAAAAAATATAGCT GTAAAGTGACGCTGCACTAT
Product: carbohydrate kinase, FGGY family
Products: NA
Alternate protein names: ATP:glycerol 3-phosphotransferase; Glycerokinase; GK [H]
Number of amino acids: Translated: 502; Mature: 501
Protein sequence:
>502_residues MPDNSAAIVIDIGTTNCKVTCFSCLDATTLGAHKFVTAKQISPQGDVDFDIDALWQEVRQAIAQLNAASPLPVRRISIAS FGESGVFLDEHGEILTPMLAWYDRRGEEYLATLSEADSAALYDICGLPLHSNYSAFKMRWLLEHYPLRNRRGLRWLHAPE VLLWRLTGEQHTDITLASRTLCLDVRKGEWSAKAAALLHVPCTAFAPLVQPGEHAGWVSESLCKTLGFSQPVSVTLAGHD HMVGARALQMMPGDILNSTGTTEGILQLDTQPTLDEQAKRDKLANGCYSLANQFTLFASLPVGGFALEWLRNTFRLTDEE IAASLTRGHADYLAGNWLLDDIPVFIPHLRGSGSPYKNRHTRGLFYGLGDTLSIDMLIASVSLGLTMEFANCFACFNVPG TSALKVIGPATHNPLWLQLKADILQRPVEAIAFNEAVSVGALLTAAPDIPPPPVAIAQRLLPNRARYHQLQRYQHKWKSW YQLKLQQEGVMPLHHREEHYVE
Sequences:
>Translated_502_residues MPDNSAAIVIDIGTTNCKVTCFSCLDATTLGAHKFVTAKQISPQGDVDFDIDALWQEVRQAIAQLNAASPLPVRRISIAS FGESGVFLDEHGEILTPMLAWYDRRGEEYLATLSEADSAALYDICGLPLHSNYSAFKMRWLLEHYPLRNRRGLRWLHAPE VLLWRLTGEQHTDITLASRTLCLDVRKGEWSAKAAALLHVPCTAFAPLVQPGEHAGWVSESLCKTLGFSQPVSVTLAGHD HMVGARALQMMPGDILNSTGTTEGILQLDTQPTLDEQAKRDKLANGCYSLANQFTLFASLPVGGFALEWLRNTFRLTDEE IAASLTRGHADYLAGNWLLDDIPVFIPHLRGSGSPYKNRHTRGLFYGLGDTLSIDMLIASVSLGLTMEFANCFACFNVPG TSALKVIGPATHNPLWLQLKADILQRPVEAIAFNEAVSVGALLTAAPDIPPPPVAIAQRLLPNRARYHQLQRYQHKWKSW YQLKLQQEGVMPLHHREEHYVE >Mature_501_residues PDNSAAIVIDIGTTNCKVTCFSCLDATTLGAHKFVTAKQISPQGDVDFDIDALWQEVRQAIAQLNAASPLPVRRISIASF GESGVFLDEHGEILTPMLAWYDRRGEEYLATLSEADSAALYDICGLPLHSNYSAFKMRWLLEHYPLRNRRGLRWLHAPEV LLWRLTGEQHTDITLASRTLCLDVRKGEWSAKAAALLHVPCTAFAPLVQPGEHAGWVSESLCKTLGFSQPVSVTLAGHDH MVGARALQMMPGDILNSTGTTEGILQLDTQPTLDEQAKRDKLANGCYSLANQFTLFASLPVGGFALEWLRNTFRLTDEEI AASLTRGHADYLAGNWLLDDIPVFIPHLRGSGSPYKNRHTRGLFYGLGDTLSIDMLIASVSLGLTMEFANCFACFNVPGT SALKVIGPATHNPLWLQLKADILQRPVEAIAFNEAVSVGALLTAAPDIPPPPVAIAQRLLPNRARYHQLQRYQHKWKSWY QLKLQQEGVMPLHHREEHYVE
Specific function: Key enzyme in the regulation of glycerol uptake and metabolism [H]
COG id: COG1070
COG function: function code G; Sugar (pentulose and hexulose) kinases
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the FGGY kinase family [H]
Homologues:
Organism=Homo sapiens, GI42794763, Length=453, Percent_Identity=24.0618101545254, Blast_Score=85, Evalue=2e-16, Organism=Homo sapiens, GI41393575, Length=447, Percent_Identity=24.1610738255034, Blast_Score=85, Evalue=2e-16, Organism=Homo sapiens, GI4504007, Length=451, Percent_Identity=23.9467849223947, Blast_Score=84, Evalue=2e-16, Organism=Homo sapiens, GI189409120, Length=451, Percent_Identity=23.9467849223947, Blast_Score=84, Evalue=3e-16, Organism=Escherichia coli, GI1789168, Length=460, Percent_Identity=26.304347826087, Blast_Score=106, Evalue=3e-24, Organism=Escherichia coli, GI1789987, Length=490, Percent_Identity=22.6530612244898, Blast_Score=82, Evalue=8e-17, Organism=Caenorhabditis elegans, GI17535599, Length=447, Percent_Identity=23.7136465324385, Blast_Score=97, Evalue=1e-20, Organism=Drosophila melanogaster, GI17864214, Length=538, Percent_Identity=23.7918215613383, Blast_Score=97, Evalue=3e-20, Organism=Drosophila melanogaster, GI24654573, Length=464, Percent_Identity=24.5689655172414, Blast_Score=95, Evalue=9e-20, Organism=Drosophila melanogaster, GI19922058, Length=339, Percent_Identity=23.3038348082596, Blast_Score=68, Evalue=1e-11,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR000577 - InterPro: IPR018485 - InterPro: IPR018483 - InterPro: IPR018484 - InterPro: IPR005999 [H]
Pfam domain/function: PF02782 FGGY_C; PF00370 FGGY_N [H]
EC number: =2.7.1.30 [H]
Molecular weight: Translated: 55576; Mature: 55445
Theoretical pI: Translated: 6.55; Mature: 6.55
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
2.0 %Cys (Translated Protein) 1.8 %Met (Translated Protein) 3.8 %Cys+Met (Translated Protein) 2.0 %Cys (Mature Protein) 1.6 %Met (Mature Protein) 3.6 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MPDNSAAIVIDIGTTNCKVTCFSCLDATTLGAHKFVTAKQISPQGDVDFDIDALWQEVRQ CCCCCCEEEEEECCCCCEEEEEEHHCCHHCCCHHEEEECCCCCCCCCCCCHHHHHHHHHH AIAQLNAASPLPVRRISIASFGESGVFLDEHGEILTPMLAWYDRRGEEYLATLSEADSAA HHHHCCCCCCCCEEEEEEECCCCCCCEECCCCCHHHHHHHHHHCCCHHHHHHHHHCCCHH LYDICGLPLHSNYSAFKMRWLLEHYPLRNRRGLRWLHAPEVLLWRLTGEQHTDITLASRT HHHHCCCCCCCCCHHHHHHHHHHHCCCCCCCCCEEEECCCEEEEEECCCCCCCEEEECEE LCLDVRKGEWSAKAAALLHVPCTAFAPLVQPGEHAGWVSESLCKTLGFSQPVSVTLAGHD EEEEECCCCCCCCEEEEEECCHHHHHHCCCCCCCCCHHHHHHHHHCCCCCCEEEEECCCC HMVGARALQMMPGDILNSTGTTEGILQLDTQPTLDEQAKRDKLANGCYSLANQFTLFASL CHHHHHHHHHCCCHHHCCCCCCCCEEEECCCCCHHHHHHHHHHHHHHHHHHHCEEEEEEC PVGGFALEWLRNTFRLTDEEIAASLTRGHADYLAGNWLLDDIPVFIPHLRGSGSPYKNRH CCCHHHHHHHHHHHCCCHHHHHHHHHCCCHHHHCCCCCHHCHHHHHHCCCCCCCCCCCCC TRGLFYGLGDTLSIDMLIASVSLGLTMEFANCFACFNVPGTSALKVIGPATHNPLWLQLK CCEEEEECCCCHHHHHHHHHHHHCEEEEHHCEEEEECCCCCCEEEEECCCCCCCEEEEEE ADILQRPVEAIAFNEAVSVGALLTAAPDIPPPPVAIAQRLLPNRARYHQLQRYQHKWKSW HHHHHCHHHHHHHHHHHHHCCCEECCCCCCCCCHHHHHHHCCCHHHHHHHHHHHHHHHHH YQLKLQQEGVMPLHHREEHYVE EEEEEECCCCCCCCCCHHHCCC >Mature Secondary Structure PDNSAAIVIDIGTTNCKVTCFSCLDATTLGAHKFVTAKQISPQGDVDFDIDALWQEVRQ CCCCCEEEEEECCCCCEEEEEEHHCCHHCCCHHEEEECCCCCCCCCCCCHHHHHHHHHH AIAQLNAASPLPVRRISIASFGESGVFLDEHGEILTPMLAWYDRRGEEYLATLSEADSAA HHHHCCCCCCCCEEEEEEECCCCCCCEECCCCCHHHHHHHHHHCCCHHHHHHHHHCCCHH LYDICGLPLHSNYSAFKMRWLLEHYPLRNRRGLRWLHAPEVLLWRLTGEQHTDITLASRT HHHHCCCCCCCCCHHHHHHHHHHHCCCCCCCCCEEEECCCEEEEEECCCCCCCEEEECEE LCLDVRKGEWSAKAAALLHVPCTAFAPLVQPGEHAGWVSESLCKTLGFSQPVSVTLAGHD EEEEECCCCCCCCEEEEEECCHHHHHHCCCCCCCCCHHHHHHHHHCCCCCCEEEEECCCC HMVGARALQMMPGDILNSTGTTEGILQLDTQPTLDEQAKRDKLANGCYSLANQFTLFASL CHHHHHHHHHCCCHHHCCCCCCCCEEEECCCCCHHHHHHHHHHHHHHHHHHHCEEEEEEC PVGGFALEWLRNTFRLTDEEIAASLTRGHADYLAGNWLLDDIPVFIPHLRGSGSPYKNRH CCCHHHHHHHHHHHCCCHHHHHHHHHCCCHHHHCCCCCHHCHHHHHHCCCCCCCCCCCCC TRGLFYGLGDTLSIDMLIASVSLGLTMEFANCFACFNVPGTSALKVIGPATHNPLWLQLK CCEEEEECCCCHHHHHHHHHHHHCEEEEHHCEEEEECCCCCCEEEEECCCCCCCEEEEEE ADILQRPVEAIAFNEAVSVGALLTAAPDIPPPPVAIAQRLLPNRARYHQLQRYQHKWKSW HHHHHCHHHHHHHHHHHHHCCCEECCCCCCCCCHHHHHHHCCCHHHHHHHHHHHHHHHHH YQLKLQQEGVMPLHHREEHYVE EEEEEECCCCCCCCCCHHHCCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 11337471 [H]