Definition Escherichia coli ED1a chromosome, complete genome.
Accession NC_011745
Length 5,209,548

Click here to switch to the map view.

The map label for this gene is ycjM [H]

Identifier: 218689299

GI number: 218689299

Start: 1488920

End: 1490599

Strand: Direct

Name: ycjM [H]

Synonym: ECED1_1517

Alternate gene names: 218689299

Gene position: 1488920-1490599 (Clockwise)

Preceding gene: 218689298

Following gene: 218689300

Centisome position: 28.58

GC content: 43.69

Gene sequence:

>1680_bases
ATGAAACAGAAAATTACGGATTACCTGGACGAAATCTACGGTGGAACATTTACCGCGACTCATTTACAGAAACTTGTAAC
GCGTCTTGAGAGTGCGAAACGATTAATTACACAGCGACGTAAAAAACACTGGGATGAAAGTGATGTCGTGTTAATTACCT
ATGCCGATCAATTTCACAGTAATGATTTAAAGCCACTACCCACATTTAATCAGTTTTACCCTCAATGGCTGCAAAGAATT
TTTTCACATGTTCATTTATTACCTTTTTATCCATGGTCATCTGATGATGGATTTTCGGTAATTGATTATCATCAGGTCGC
CAGTGAAGCGGGGGAGTGGCAGGATATTCAGCAACTCGGTGAATGCAGCCATTTAATGTTTGATTTTGTCTGCAACCATA
TGTCGGCAAAAAGTGAATGGTTTAAAAACTATTTACAACAGCAGCCAGGTTTTGAAGATTTTTTTATTGCCGTTGATCCG
AAAACCGATCTCAGCGCCGTCACTCGCCCGCGTGCGTTACCGTTATTAACGCCATTCCAGATGCGCGATCATTCAATGCG
CCATTTATGGACCACCTTTAGCGATGATCAAATTGACCTCAATTACCGTAGCCCTGAAGTGTTGCTGGCGATGGTGGATG
TATTGCTGTGCTACCTGGAAAAGGGCGCAGAGTATGTCCGTCTGGATGCCGTTGGCTTTATGTGGAAAGAGCCGGGAACA
AACTGCATCCATCTGGAAAAAACACATCTGATTATCAAACTGTTACGGTCGATTATTGATAACGTCGCGCCAGGCACAGT
GATCATTACCGAGACCAATGTTCCGCATAAAGACAACATTGCTTACTTTGGCGAAGGCGATGACGAAGCGCATATGGTGT
ACCAGTTCTCGCTGCCGCCGCTGGTGCTGCATGCGGTGCAAAAACAGAACGTTGAGGCACTTTGTGCGTGGGCGCAAAAC
CTGACACTACCTTCCAGCAACACCACCTGGTTTAACTTCCTTGCCTCTCACGATGGCATCGGGCTTAACCCACTGCGGGG
GTTGTTGCCCGAAAACGAAATATTAGCGCTGGTCGAGGTGTTACAGCAGGAAGGAGCATTAGTAAACTGGAAAAATAATC
CCGACGGTACGCGTAGCCCCTATGAAATGAATGTCACCTATATGGATGCGTTGAGCCGCCGTGAGTGTAGCGACGAAGAA
CGGTGTGCCAGGTTTATTCTCGCCCATGCGATTTTGTTAAGTTTCCCCGGTGTGCCAGCGATATATATTCAAAGCATTCT
GGGGTCGCGTAATGATTACGCAGGTGTCGAAAAACTTGGATATAATCGTGCGATTAACCGTAAAAAATACTCTAGTAAAG
AGATAACGACAGAACTGAACAATAAAGCGACATTAAGTTATTCGGTATATTATAAGTTGTCGCATTTAATTACACTTCGT
CGCAGTCATAAAGAGTTTCATCCGGATAATAATTTCACCATTGATGCGATTAATTCATTTGTAATGCGAATTCAAAGAAG
CAATGCGGATGGCGATTGCCTGACGGGATTGTTTAATGTCAGTGAAAATATTCAGCATATAAATATTACTGACCTGCACG
GTCGGGATCTGATTAGTGAAGTTGATATATTGGGTAATGAAATAACACTGCATCCCTGGCAGGTTATGTGGATTAAATAA

Upstream 100 bases:

>100_bases
AAAGATTTCCTGCGTGACTAAACCCCTTGAGCTCAATTGACAGTTTATTTTATGCGGAGTAGTCTCTCGTTTCATGGGAC
CGCTACCACGGAAAGGCAAC

Downstream 100 bases:

>100_bases
AAAGGAACATTTCATGATTAAATCAAAAATCGTGCTGTTATCAGCACTGGTTTCCTGCACCCTGATTTCAGGCTGTAAAG
AAGAAAATAAAAATAATGTA

Product: putative glucosyltransferase

Products: NA

Alternate protein names: Sucrose glucosyltransferase [H]

Number of amino acids: Translated: 559; Mature: 559

Protein sequence:

>559_residues
MKQKITDYLDEIYGGTFTATHLQKLVTRLESAKRLITQRRKKHWDESDVVLITYADQFHSNDLKPLPTFNQFYPQWLQRI
FSHVHLLPFYPWSSDDGFSVIDYHQVASEAGEWQDIQQLGECSHLMFDFVCNHMSAKSEWFKNYLQQQPGFEDFFIAVDP
KTDLSAVTRPRALPLLTPFQMRDHSMRHLWTTFSDDQIDLNYRSPEVLLAMVDVLLCYLEKGAEYVRLDAVGFMWKEPGT
NCIHLEKTHLIIKLLRSIIDNVAPGTVIITETNVPHKDNIAYFGEGDDEAHMVYQFSLPPLVLHAVQKQNVEALCAWAQN
LTLPSSNTTWFNFLASHDGIGLNPLRGLLPENEILALVEVLQQEGALVNWKNNPDGTRSPYEMNVTYMDALSRRECSDEE
RCARFILAHAILLSFPGVPAIYIQSILGSRNDYAGVEKLGYNRAINRKKYSSKEITTELNNKATLSYSVYYKLSHLITLR
RSHKEFHPDNNFTIDAINSFVMRIQRSNADGDCLTGLFNVSENIQHINITDLHGRDLISEVDILGNEITLHPWQVMWIK

Sequences:

>Translated_559_residues
MKQKITDYLDEIYGGTFTATHLQKLVTRLESAKRLITQRRKKHWDESDVVLITYADQFHSNDLKPLPTFNQFYPQWLQRI
FSHVHLLPFYPWSSDDGFSVIDYHQVASEAGEWQDIQQLGECSHLMFDFVCNHMSAKSEWFKNYLQQQPGFEDFFIAVDP
KTDLSAVTRPRALPLLTPFQMRDHSMRHLWTTFSDDQIDLNYRSPEVLLAMVDVLLCYLEKGAEYVRLDAVGFMWKEPGT
NCIHLEKTHLIIKLLRSIIDNVAPGTVIITETNVPHKDNIAYFGEGDDEAHMVYQFSLPPLVLHAVQKQNVEALCAWAQN
LTLPSSNTTWFNFLASHDGIGLNPLRGLLPENEILALVEVLQQEGALVNWKNNPDGTRSPYEMNVTYMDALSRRECSDEE
RCARFILAHAILLSFPGVPAIYIQSILGSRNDYAGVEKLGYNRAINRKKYSSKEITTELNNKATLSYSVYYKLSHLITLR
RSHKEFHPDNNFTIDAINSFVMRIQRSNADGDCLTGLFNVSENIQHINITDLHGRDLISEVDILGNEITLHPWQVMWIK
>Mature_559_residues
MKQKITDYLDEIYGGTFTATHLQKLVTRLESAKRLITQRRKKHWDESDVVLITYADQFHSNDLKPLPTFNQFYPQWLQRI
FSHVHLLPFYPWSSDDGFSVIDYHQVASEAGEWQDIQQLGECSHLMFDFVCNHMSAKSEWFKNYLQQQPGFEDFFIAVDP
KTDLSAVTRPRALPLLTPFQMRDHSMRHLWTTFSDDQIDLNYRSPEVLLAMVDVLLCYLEKGAEYVRLDAVGFMWKEPGT
NCIHLEKTHLIIKLLRSIIDNVAPGTVIITETNVPHKDNIAYFGEGDDEAHMVYQFSLPPLVLHAVQKQNVEALCAWAQN
LTLPSSNTTWFNFLASHDGIGLNPLRGLLPENEILALVEVLQQEGALVNWKNNPDGTRSPYEMNVTYMDALSRRECSDEE
RCARFILAHAILLSFPGVPAIYIQSILGSRNDYAGVEKLGYNRAINRKKYSSKEITTELNNKATLSYSVYYKLSHLITLR
RSHKEFHPDNNFTIDAINSFVMRIQRSNADGDCLTGLFNVSENIQHINITDLHGRDLISEVDILGNEITLHPWQVMWIK

Specific function: Unknown

COG id: COG0366

COG function: function code G; Glycosidases

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the sucrose phosphorylase family [H]

Homologues:

Organism=Escherichia coli, GI87081873, Length=559, Percent_Identity=94.2754919499105, Blast_Score=1105, Evalue=0.0,
Organism=Drosophila melanogaster, GI24583749, Length=171, Percent_Identity=30.9941520467836, Blast_Score=85, Evalue=2e-16,
Organism=Drosophila melanogaster, GI24583747, Length=171, Percent_Identity=30.9941520467836, Blast_Score=84, Evalue=2e-16,
Organism=Drosophila melanogaster, GI24583745, Length=153, Percent_Identity=31.3725490196078, Blast_Score=74, Evalue=2e-13,
Organism=Drosophila melanogaster, GI45549022, Length=294, Percent_Identity=23.469387755102, Blast_Score=71, Evalue=2e-12,
Organism=Drosophila melanogaster, GI221330053, Length=166, Percent_Identity=28.3132530120482, Blast_Score=67, Evalue=3e-11,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR006047
- InterPro:   IPR017853
- InterPro:   IPR013781
- InterPro:   IPR016377 [H]

Pfam domain/function: PF00128 Alpha-amylase [H]

EC number: =2.4.1.7 [H]

Molecular weight: Translated: 64356; Mature: 64356

Theoretical pI: Translated: 6.10; Mature: 6.10

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.4 %Cys     (Translated Protein)
2.1 %Met     (Translated Protein)
3.6 %Cys+Met (Translated Protein)
1.4 %Cys     (Mature Protein)
2.1 %Met     (Mature Protein)
3.6 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKQKITDYLDEIYGGTFTATHLQKLVTRLESAKRLITQRRKKHWDESDVVLITYADQFHS
CCCHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCEEEEEEECCCCC
NDLKPLPTFNQFYPQWLQRIFSHVHLLPFYPWSSDDGFSVIDYHQVASEAGEWQDIQQLG
CCCCCCCCHHHHHHHHHHHHHHHHEEEEECCCCCCCCCEEEHHHHHHHCCCCHHHHHHHH
ECSHLMFDFVCNHMSAKSEWFKNYLQQQPGFEDFFIAVDPKTDLSAVTRPRALPLLTPFQ
HHHHHHHHHHHHHHCHHHHHHHHHHHHCCCCCCEEEEECCCCCHHHHCCCCCCCCCCCHH
MRDHSMRHLWTTFSDDQIDLNYRSPEVLLAMVDVLLCYLEKGAEYVRLDAVGFMWKEPGT
HCCCCHHHHEECCCCCEEEECCCCHHHHHHHHHHHHHHHHCCCCEEEEEEEEEEECCCCC
NCIHLEKTHLIIKLLRSIIDNVAPGTVIITETNVPHKDNIAYFGEGDDEAHMVYQFSLPP
CEEEEHHHHHHHHHHHHHHHCCCCCEEEEEECCCCCCCCEEEECCCCCCCEEEEEECCCH
LVLHAVQKQNVEALCAWAQNLTLPSSNTTWFNFLASHDGIGLNPLRGLLPENEILALVEV
HHHHHHHHCCHHHHHHHHHHCCCCCCCCHHEEEECCCCCCCCCHHHHCCCCHHHHHHHHH
LQQEGALVNWKNNPDGTRSPYEMNVTYMDALSRRECSDEERCARFILAHAILLSFPGVPA
HHHCCCEEEECCCCCCCCCCEEEEEHHHHHHHHHCCCCHHHHHHHHHHHHHHHHCCCCHH
IYIQSILGSRNDYAGVEKLGYNRAINRKKYSSKEITTELNNKATLSYSVYYKLSHLITLR
HHHHHHHCCCCCCCHHHHHCCHHHCCCCCCCCHHHHHHCCCCEEEEEEHHHHHHHHHHHH
RSHKEFHPDNNFTIDAINSFVMRIQRSNADGDCLTGLFNVSENIQHINITDLHGRDLISE
HHHHHCCCCCCEEHHHHHHHHHHHHCCCCCCHHHHHHHHHCCCCEEEEEECCCCHHHHHH
VDILGNEITLHPWQVMWIK
HHHCCCEEEECCEEEEEEC
>Mature Secondary Structure
MKQKITDYLDEIYGGTFTATHLQKLVTRLESAKRLITQRRKKHWDESDVVLITYADQFHS
CCCHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCEEEEEEECCCCC
NDLKPLPTFNQFYPQWLQRIFSHVHLLPFYPWSSDDGFSVIDYHQVASEAGEWQDIQQLG
CCCCCCCCHHHHHHHHHHHHHHHHEEEEECCCCCCCCCEEEHHHHHHHCCCCHHHHHHHH
ECSHLMFDFVCNHMSAKSEWFKNYLQQQPGFEDFFIAVDPKTDLSAVTRPRALPLLTPFQ
HHHHHHHHHHHHHHCHHHHHHHHHHHHCCCCCCEEEEECCCCCHHHHCCCCCCCCCCCHH
MRDHSMRHLWTTFSDDQIDLNYRSPEVLLAMVDVLLCYLEKGAEYVRLDAVGFMWKEPGT
HCCCCHHHHEECCCCCEEEECCCCHHHHHHHHHHHHHHHHCCCCEEEEEEEEEEECCCCC
NCIHLEKTHLIIKLLRSIIDNVAPGTVIITETNVPHKDNIAYFGEGDDEAHMVYQFSLPP
CEEEEHHHHHHHHHHHHHHHCCCCCEEEEEECCCCCCCCEEEECCCCCCCEEEEEECCCH
LVLHAVQKQNVEALCAWAQNLTLPSSNTTWFNFLASHDGIGLNPLRGLLPENEILALVEV
HHHHHHHHCCHHHHHHHHHHCCCCCCCCHHEEEECCCCCCCCCHHHHCCCCHHHHHHHHH
LQQEGALVNWKNNPDGTRSPYEMNVTYMDALSRRECSDEERCARFILAHAILLSFPGVPA
HHHCCCEEEECCCCCCCCCCEEEEEHHHHHHHHHCCCCHHHHHHHHHHHHHHHHCCCCHH
IYIQSILGSRNDYAGVEKLGYNRAINRKKYSSKEITTELNNKATLSYSVYYKLSHLITLR
HHHHHHHCCCCCCCHHHHHCCHHHCCCCCCCCHHHHHHCCCCEEEEEEHHHHHHHHHHHH
RSHKEFHPDNNFTIDAINSFVMRIQRSNADGDCLTGLFNVSENIQHINITDLHGRDLISE
HHHHHCCCCCCEEHHHHHHHHHHHHCCCCCCHHHHHHHHHCCCCEEEEEECCCCHHHHHH
VDILGNEITLHPWQVMWIK
HHHCCCEEEECCEEEEEEC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 9097039; 9278503 [H]