| Definition | Mesorhizobium loti MAFF303099 chromosome, complete genome. |
|---|---|
| Accession | NC_002678 |
| Length | 7,036,071 |
Click here to switch to the map view.
The map label for this gene is iolC [H]
Identifier: 13474160
GI number: 13474160
Start: 3949969
End: 3951903
Strand: Reverse
Name: iolC [H]
Synonym: mll4982
Alternate gene names: 13474160
Gene position: 3951903-3949969 (Counterclockwise)
Preceding gene: 13474161
Following gene: 13474159
Centisome position: 56.17
GC content: 65.27
Gene sequence:
>1935_bases ATGAGCGAAGCCGTGGACGCCAAACAGGCGCCGCTCGACGTCATCACCATCGGTCGCGCTTCCGTCGACCTCTACGGCCA GCAGATCGGCTCGCGGCTGGAGGACATCACCTCTTTCGCCAAGTCGGTCGGTGGTTGCCCGGCCAACATTTCGGTCGGGA CCGCAAGGCTCGGCCTGCGCTCGGCGCTGCTGACGCGCGTCGGCGACGAGCAGATGGGCCGCTTCATCCGCGAACAGCTG AGGCGCGAAGGCGTCAACACCGACGGGCTGAAGACCGACAAGGAGCGGTTGACCGCGCTGGTGCTGCTTTCGGTCGAGAG CGAAGGCGTGTCGCCGATGATCTTCTACCGCTCAGACTGCGCCGACATGGCGCTTGCGCCGGAGGACATTGACGAGGCGT TTATCGCCTCGGCGCGTTCGATCGTCGTCACCGGCACGCATTTTTCCCGCCCCAACAGCGACGCCGCCCAGCGCAAGGCG ATCCGCATCATGAAAGCCAAGGGCGGCAAGGTTGTCTTCGACATCGACTATCGGCCCAATCTGTGGGGCCTCGCCGGCCA TGCCGAAGGCTTCGAGCGCTATGTCAAATCGGACCGGGTCTCGGCGCAGCTGAAGACGGTTCTGCCCGATTGCGATCTCA TCGTCGGCACCGAGGAAGAGATCATGATCGCCTCGGGTGCCGACGATTGCCTGAGCGCGCTGAAGACGATCCGCGCGCTG TCGGCGGCGACGATCGTGCTCAAGCGCGGCGCCATGGGCTGCATCGTCTATGACGGACCGATCAGCGACGATCTCGAAGA CGGTATCGTCGGCAAGGGTTTCCCGATCGAGATCTACAATGTGCTGGGCGCCGGCGACGCCTTCATGTCCGGCTTCCTGC GCGGCTGGCTGGGCGGCGAAGATCATGCGACGGCGGCGACCTGGGCCAATGCCTGCGGCGCCTTCGCCGTGTCGCGACTG CTGTGCGCACCGGAATATCCGACCTTCGAGGAGCTGCAGTTCTTCCTCAAGAACGGCAGCAAATACAGGGCGCTGCGCAA GGACGAGGCGATCAACCACATTCATTGGGCAACGACCCGGCGGCGCGACATCCCCTCGCTGATGGCGCTCGCCTGCGACC ACCGCGTGCAGCTCGAGGACGTGGCGGCGAAGGCCGGCGCCGATCCGGCGCGCATCCGCGACTTCAAGGTGCTGGCGGTC AAGGCGGCGGCGAAGGTCGCCGCCGGCCGTGACGGCTATGGCATGCTGATCGACGAGAAACATGGCCGCGAGGCGATGTT CGAATTCGCCAGGCATCCCTTCGCCTGGCTCGGGCGCCCGGTGGAACTGCCGGGCTCGCGGCCGCTGCGCTTCGAGTTCT CGCAGGATATCGGCTCGCAACTGGTGGAATGGCCGGTCGACCATTGCATCAAGTGCCTGTGCTTCTACCATCCCGACGAT CCGGCGGCCTTGAAGGAAGAACAGCAGCAGAAATTGCGCGCGCTGTTTGAGGCGGCGCGGAAAGTTGGCCGGGAACTGCT CGTCGAGATCATCGCCGGCAAGCACGGCAAGCTCGACAACACGACCATTCCGCGCGCGCTGGAAGAGCTTTATGCACTCG GCATCAAGCCGGATTGGTGGAAGCTCGAACCGCAGGCTTCAGCCGGTGCCTGGACCAGGATCGAAGCGGTCATCCTGAAG CATGATCCCTGGTGCCGTGGCATCGTGCTGCTTGGCCTGGAAGCGCCGCAGGACGAGCTGGAGGCGGCTTTCGCCGCCAC CGCCAAGGCGCCGATCGTCAAGGGCTTTGCCGTCGGCCGCACGATCTTCGTGCACGCGGCCGAAGAGTGGCTGGCCGGCA GGATGTCGGATGACGAGGCTGTCGCCGACATGGCCTCGCGCTTTGAACAGTTGACCGAGGCGTGGCTTGCCGCGCGCGGC CGCAAGGCGGCATAA
Upstream 100 bases:
>100_bases GGATTGGAATTATTATTTCATATTCCCGGCACCACGCTGCCGCTCGCGCGTGTTACCCAAACAATGTTGTTCCTGACAAC AAGTCTGAAGGGAGGTTCCA
Downstream 100 bases:
>100_bases GAAGGCGCGGCACAAGGACTGCGGAGGAAACCATCATGAGCAAGACAATCCGCCTGACGATGGCGCAGGCGCTGACCCGC TTCCTGTCCCGCCAGATGAC
Product: myo-inositol catabolism iolC
Products: NA
Alternate protein names: 2-deoxy-5-keto-D-gluconate kinase; DKG kinase [H]
Number of amino acids: Translated: 644; Mature: 643
Protein sequence:
>644_residues MSEAVDAKQAPLDVITIGRASVDLYGQQIGSRLEDITSFAKSVGGCPANISVGTARLGLRSALLTRVGDEQMGRFIREQL RREGVNTDGLKTDKERLTALVLLSVESEGVSPMIFYRSDCADMALAPEDIDEAFIASARSIVVTGTHFSRPNSDAAQRKA IRIMKAKGGKVVFDIDYRPNLWGLAGHAEGFERYVKSDRVSAQLKTVLPDCDLIVGTEEEIMIASGADDCLSALKTIRAL SAATIVLKRGAMGCIVYDGPISDDLEDGIVGKGFPIEIYNVLGAGDAFMSGFLRGWLGGEDHATAATWANACGAFAVSRL LCAPEYPTFEELQFFLKNGSKYRALRKDEAINHIHWATTRRRDIPSLMALACDHRVQLEDVAAKAGADPARIRDFKVLAV KAAAKVAAGRDGYGMLIDEKHGREAMFEFARHPFAWLGRPVELPGSRPLRFEFSQDIGSQLVEWPVDHCIKCLCFYHPDD PAALKEEQQQKLRALFEAARKVGRELLVEIIAGKHGKLDNTTIPRALEELYALGIKPDWWKLEPQASAGAWTRIEAVILK HDPWCRGIVLLGLEAPQDELEAAFAATAKAPIVKGFAVGRTIFVHAAEEWLAGRMSDDEAVADMASRFEQLTEAWLAARG RKAA
Sequences:
>Translated_644_residues MSEAVDAKQAPLDVITIGRASVDLYGQQIGSRLEDITSFAKSVGGCPANISVGTARLGLRSALLTRVGDEQMGRFIREQL RREGVNTDGLKTDKERLTALVLLSVESEGVSPMIFYRSDCADMALAPEDIDEAFIASARSIVVTGTHFSRPNSDAAQRKA IRIMKAKGGKVVFDIDYRPNLWGLAGHAEGFERYVKSDRVSAQLKTVLPDCDLIVGTEEEIMIASGADDCLSALKTIRAL SAATIVLKRGAMGCIVYDGPISDDLEDGIVGKGFPIEIYNVLGAGDAFMSGFLRGWLGGEDHATAATWANACGAFAVSRL LCAPEYPTFEELQFFLKNGSKYRALRKDEAINHIHWATTRRRDIPSLMALACDHRVQLEDVAAKAGADPARIRDFKVLAV KAAAKVAAGRDGYGMLIDEKHGREAMFEFARHPFAWLGRPVELPGSRPLRFEFSQDIGSQLVEWPVDHCIKCLCFYHPDD PAALKEEQQQKLRALFEAARKVGRELLVEIIAGKHGKLDNTTIPRALEELYALGIKPDWWKLEPQASAGAWTRIEAVILK HDPWCRGIVLLGLEAPQDELEAAFAATAKAPIVKGFAVGRTIFVHAAEEWLAGRMSDDEAVADMASRFEQLTEAWLAARG RKAA >Mature_643_residues SEAVDAKQAPLDVITIGRASVDLYGQQIGSRLEDITSFAKSVGGCPANISVGTARLGLRSALLTRVGDEQMGRFIREQLR REGVNTDGLKTDKERLTALVLLSVESEGVSPMIFYRSDCADMALAPEDIDEAFIASARSIVVTGTHFSRPNSDAAQRKAI RIMKAKGGKVVFDIDYRPNLWGLAGHAEGFERYVKSDRVSAQLKTVLPDCDLIVGTEEEIMIASGADDCLSALKTIRALS AATIVLKRGAMGCIVYDGPISDDLEDGIVGKGFPIEIYNVLGAGDAFMSGFLRGWLGGEDHATAATWANACGAFAVSRLL CAPEYPTFEELQFFLKNGSKYRALRKDEAINHIHWATTRRRDIPSLMALACDHRVQLEDVAAKAGADPARIRDFKVLAVK AAAKVAAGRDGYGMLIDEKHGREAMFEFARHPFAWLGRPVELPGSRPLRFEFSQDIGSQLVEWPVDHCIKCLCFYHPDDP AALKEEQQQKLRALFEAARKVGRELLVEIIAGKHGKLDNTTIPRALEELYALGIKPDWWKLEPQASAGAWTRIEAVILKH DPWCRGIVLLGLEAPQDELEAAFAATAKAPIVKGFAVGRTIFVHAAEEWLAGRMSDDEAVADMASRFEQLTEAWLAARGR KAA
Specific function: Catalyzes the phosphorylation of 5-dehydro-2-deoxy-D- gluconate (2-deoxy-5-keto-D-gluconate or DKG) to 6-phospho-5- dehydro-2-deoxy-D-gluconate (DKGP) [H]
COG id: COG0524
COG function: function code G; Sugar kinases, ribokinase family
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the carbohydrate kinase pfkB family [H]
Homologues:
Organism=Escherichia coli, GI87081971, Length=312, Percent_Identity=27.2435897435897, Blast_Score=80, Evalue=3e-16,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR011611 - InterPro: IPR002173 - InterPro: IPR022841 [H]
Pfam domain/function: PF00294 PfkB [H]
EC number: =2.7.1.92 [H]
Molecular weight: Translated: 70449; Mature: 70318
Theoretical pI: Translated: 6.10; Mature: 6.10
Prosite motif: PS00583 PFKB_KINASES_1 ; PS00584 PFKB_KINASES_2
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.9 %Cys (Translated Protein) 2.0 %Met (Translated Protein) 3.9 %Cys+Met (Translated Protein) 1.9 %Cys (Mature Protein) 1.9 %Met (Mature Protein) 3.7 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MSEAVDAKQAPLDVITIGRASVDLYGQQIGSRLEDITSFAKSVGGCPANISVGTARLGLR CCCCCCCCCCCEEEEEECCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCHHHHHHH SALLTRVGDEQMGRFIREQLRREGVNTDGLKTDKERLTALVLLSVESEGVSPMIFYRSDC HHHHHHCCHHHHHHHHHHHHHHCCCCCCCCCCHHHHEEEEEEEEECCCCCCEEEEEECCC ADMALAPEDIDEAFIASARSIVVTGTHFSRPNSDAAQRKAIRIMKAKGGKVVFDIDYRPN HHHCCCHHHHHHHHHHCCCEEEEECCCCCCCCCHHHHHHHHHHEECCCCEEEEEECCCCC LWGLAGHAEGFERYVKSDRVSAQLKTVLPDCDLIVGTEEEIMIASGADDCLSALKTIRAL CCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCCEEECCCCCEEEECCCHHHHHHHHHHHHH SAATIVLKRGAMGCIVYDGPISDDLEDGIVGKGFPIEIYNVLGAGDAFMSGFLRGWLGGE HHHHHHHHCCCCEEEEECCCCCCCHHCCCCCCCCCEEEHHHHCCCHHHHHHHHHHCCCCC DHATAATWANACGAFAVSRLLCAPEYPTFEELQFFLKNGSKYRALRKDEAINHIHWATTR CCCHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHC RRDIPSLMALACDHRVQLEDVAAKAGADPARIRDFKVLAVKAAAKVAAGRDGYGMLIDEK CCCCHHHHHHHHCCCCHHHHHHHHCCCCHHHHCCEEEEEHHHHHHHHCCCCCCEEEEECC HGREAMFEFARHPFAWLGRPVELPGSRPLRFEFSQDIGSQLVEWPVDHCIKCLCFYHPDD CCHHHHHHHHHCCHHHCCCCEECCCCCCEEEEHHHHHHHHHHHHHHHHHHHHHHEECCCC PAALKEEQQQKLRALFEAARKVGRELLVEIIAGKHGKLDNTTIPRALEELYALGIKPDWW CHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHCCCCCCCE KLEPQASAGAWTRIEAVILKHDPWCRGIVLLGLEAPQDELEAAFAATAKAPIVKGFAVGR EECCCCCCCCCEEEEEEEEECCCCCCEEEEEECCCCHHHHHHHHHHHHCCCHHHHHHHCC TIFVHAAEEWLAGRMSDDEAVADMASRFEQLTEAWLAARGRKAA EEEEEEHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCC >Mature Secondary Structure SEAVDAKQAPLDVITIGRASVDLYGQQIGSRLEDITSFAKSVGGCPANISVGTARLGLR CCCCCCCCCCEEEEEECCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCHHHHHHH SALLTRVGDEQMGRFIREQLRREGVNTDGLKTDKERLTALVLLSVESEGVSPMIFYRSDC HHHHHHCCHHHHHHHHHHHHHHCCCCCCCCCCHHHHEEEEEEEEECCCCCCEEEEEECCC ADMALAPEDIDEAFIASARSIVVTGTHFSRPNSDAAQRKAIRIMKAKGGKVVFDIDYRPN HHHCCCHHHHHHHHHHCCCEEEEECCCCCCCCCHHHHHHHHHHEECCCCEEEEEECCCCC LWGLAGHAEGFERYVKSDRVSAQLKTVLPDCDLIVGTEEEIMIASGADDCLSALKTIRAL CCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCCEEECCCCCEEEECCCHHHHHHHHHHHHH SAATIVLKRGAMGCIVYDGPISDDLEDGIVGKGFPIEIYNVLGAGDAFMSGFLRGWLGGE HHHHHHHHCCCCEEEEECCCCCCCHHCCCCCCCCCEEEHHHHCCCHHHHHHHHHHCCCCC DHATAATWANACGAFAVSRLLCAPEYPTFEELQFFLKNGSKYRALRKDEAINHIHWATTR CCCHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHC RRDIPSLMALACDHRVQLEDVAAKAGADPARIRDFKVLAVKAAAKVAAGRDGYGMLIDEK CCCCHHHHHHHHCCCCHHHHHHHHCCCCHHHHCCEEEEEHHHHHHHHCCCCCCEEEEECC HGREAMFEFARHPFAWLGRPVELPGSRPLRFEFSQDIGSQLVEWPVDHCIKCLCFYHPDD CCHHHHHHHHHCCHHHCCCCEECCCCCCEEEEHHHHHHHHHHHHHHHHHHHHHHEECCCC PAALKEEQQQKLRALFEAARKVGRELLVEIIAGKHGKLDNTTIPRALEELYALGIKPDWW CHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHCCCCCCCE KLEPQASAGAWTRIEAVILKHDPWCRGIVLLGLEAPQDELEAAFAATAKAPIVKGFAVGR EECCCCCCCCCEEEEEEEEECCCCCCEEEEEECCCCHHHHHHHHHHHHCCCHHHHHHHCC TIFVHAAEEWLAGRMSDDEAVADMASRFEQLTEAWLAARGRKAA EEEEEEHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: NA