| Definition | Thermococcus onnurineus NA1, complete genome. |
|---|---|
| Accession | NC_011529 |
| Length | 1,847,607 |
Click here to switch to the map view.
The map label for this gene is amyM [H]
Identifier: 212224602
GI number: 212224602
Start: 1327289
End: 1329445
Strand: Reverse
Name: amyM [H]
Synonym: TON_1451
Alternate gene names: 212224602
Gene position: 1329445-1327289 (Counterclockwise)
Preceding gene: 212224603
Following gene: 212224600
Centisome position: 71.95
GC content: 54.66
Gene sequence:
>2157_bases ATGAAGCGAGCACTCGTGCTGGTTTTCATACTCCTTCTCATCCTGCCCTCAGTGGAGGCGTACAGCGTCCCCGAGCGCGG GGTCATCTATCAGGTCATGGTGGACAGGTTCTACGACGGTAACCAGAGCAACAACGAACCCTTCTACGATCCAATGCACA CCAACTACCGCCTCTACTGGGGCGGCGATCTGGAGGGTCTTATAGAGAAGCTCGACTACATCCAGAGCCTCGGTGTCTCG ATGATATGGCTCTCGCCCCTGAACGACAACATCAACAGGATGGCCGGTGGAAGCGCTCCCTACCATGGCTACTGGACGCA CGACTATAAACGCATAGAGGAGCACTTCGGTGACTGGAAAACCTTCAAGAGGCTCGTTGAAGATGCAGAAAAGAGGGGAA TCTGCATCATCGTTGACTACGTTCCCAATCATTCGAACCCTGCGACGGACGGTGAACTCGGCTCGCTCTACGACAACGGA ACGCTCGTGACGAACTACTATTACGACGCCAAAAATGCAACGGTGAACCCCTACACCGGCAGTAAGGAGTTAATATATCA CCACAATGGGGACATAGGCGACTGGTTTGGCTTTCAGCTCAAATACGCTAACCTCTTTGGCTTAGCCGACTTCAATCAGC TCAACCCCTGGGTGGATTCATACCTGAAGGACGGTGCGAGGCTCTTCGTCGAGGCCGGCGCCTGCGGCTTCAGGATCGAC GCAGTAAAGCATATGGATCTGGGATGGCTGGAGAGCTTCTACCTGGACCTCTACTCGAGCTCTGAAAGGCCGCTCTTCAT CTACGGTGAGTACTACTCCCTCAGCCCCCAGAAAACCGACGATATGTACTACTTCTACCTCTACTCGAACGTCTCCCCCT TGCTCGGTATACCGATAAGGAACGACATCGTGAGAACCTTCGCCTACGGAGGAAGCATGAAGGATCTCGCGAGGGAGCTC GAGGATTATTATTCACTCTTTGTTTATCCCAACAAACAGGTAAACTTCCTCGACAGCCACGACCTCGTTCGCTTCCTCAA CGAGAACCATCGTCTGGATCGCTACCACATGGCGCTAGCACTGACAATGACTCTTCCTGGCATTCCGGTTATCTACTACG GCGACGAGAGCTATCTGGTTAGCAAGGACGGAAAGGGCGACCCCTACAACAGGCCCATGATGGTCTTCAACAACACAACG GAGGCGGCGCGGATAATCAGAACCCTTGCGGAGCTGAGGAAGACCAACGACGCTTTAGCCTTCGGCGACTTCAGAACCCT CTACGCTGACTACAACGTCTGGGCATTTGAGAGAGCCTTCGGGGCTCATAGACTCCTTGTGGTCATGAACAAGGGCCCGG ACAAAAACCTCACGCTTTCGCTCGACTGGAGCGATGGGAGATACGTCGATGCCCTCCACGGGGCCGAAATGGTGGTTGAA AATGGTAGAGCAAGCGTGACACTCCCGCGCAATTCCATCTACATCTTCCACGTGGAGGGCGAGCAGAAAGAACCTCTCAT AGGCTCGCTCACGCCTTACACGGCTCAACCGGGCCAGAGGGTTCTCGTAGCCGGAGCGGGCTTTGGAAACGATGGAGAGG TATTCATCGGCGGCGAGAAGGCGAAGGTGCTCTCGTGGGAGGACGACCAGATACTCGTTGAGGTCCCTGAGGTGGAAACT GAGGACTCGTGGATTTCCGTCTACGTTGAGACGAGTTACGGAAAGAGTAACACCGTAAAGCTGCACTACTATTCCAGCGG GGACGTCCCTTCACTGATAGTCGTCAATGGCAGCAACCTGACGGGCTCCCTTTGGATTAAAGGAAGCCTTCCGGAGTTGG CCGAGCCGAGGCCGCTGATAAAGTCGAGCACGGGCTACTACTTTACAGTCGTGCCGCTCCCCAACGGGACGATTTTCTCG GTCGAGCTCTACAGGGGTCTGCCATGGGATGAACTTGAGCCGCTCAACATCACCCTCTACGGGAGGACAAACTCAACGGT TCTCCTTAGCACGGAACTCACAGAAATTCCGACGGAAAGATTGACCACAACGTCCCCAGAAATGCCGGGCAAATCCCCGG ACTGGATCCCCTACGTGGCCCTTGTGACAATTGGGGCACTCCTGCTCCTGTTGGCCTTTAGAAAGGGCAGGCTTTGA
Upstream 100 bases:
>100_bases AACGATGAGATAATGGGTTCCAACATCTCCCTGCGCTTCAGAGACATAGCCGGAATATGAACTTTTTTAAGCCCTTTCCC TTATCACTTCTGGTGATATA
Downstream 100 bases:
>100_bases TTTTTCTCCCTTTTGGGGAGATTAGGGGAAAAACTAAATCTGCTCCAACAGCTTCTTTCTCTTTTCCTCGTACTCCTCCT GAGTAATAACGCCCATATCG
Product: cyclomaltodextrin glucanotransferase
Products: NA
Alternate protein names: Glucan 1,4-alpha-maltohydrolase [H]
Number of amino acids: Translated: 718; Mature: 718
Protein sequence:
>718_residues MKRALVLVFILLLILPSVEAYSVPERGVIYQVMVDRFYDGNQSNNEPFYDPMHTNYRLYWGGDLEGLIEKLDYIQSLGVS MIWLSPLNDNINRMAGGSAPYHGYWTHDYKRIEEHFGDWKTFKRLVEDAEKRGICIIVDYVPNHSNPATDGELGSLYDNG TLVTNYYYDAKNATVNPYTGSKELIYHHNGDIGDWFGFQLKYANLFGLADFNQLNPWVDSYLKDGARLFVEAGACGFRID AVKHMDLGWLESFYLDLYSSSERPLFIYGEYYSLSPQKTDDMYYFYLYSNVSPLLGIPIRNDIVRTFAYGGSMKDLAREL EDYYSLFVYPNKQVNFLDSHDLVRFLNENHRLDRYHMALALTMTLPGIPVIYYGDESYLVSKDGKGDPYNRPMMVFNNTT EAARIIRTLAELRKTNDALAFGDFRTLYADYNVWAFERAFGAHRLLVVMNKGPDKNLTLSLDWSDGRYVDALHGAEMVVE NGRASVTLPRNSIYIFHVEGEQKEPLIGSLTPYTAQPGQRVLVAGAGFGNDGEVFIGGEKAKVLSWEDDQILVEVPEVET EDSWISVYVETSYGKSNTVKLHYYSSGDVPSLIVVNGSNLTGSLWIKGSLPELAEPRPLIKSSTGYYFTVVPLPNGTIFS VELYRGLPWDELEPLNITLYGRTNSTVLLSTELTEIPTERLTTTSPEMPGKSPDWIPYVALVTIGALLLLLAFRKGRL
Sequences:
>Translated_718_residues MKRALVLVFILLLILPSVEAYSVPERGVIYQVMVDRFYDGNQSNNEPFYDPMHTNYRLYWGGDLEGLIEKLDYIQSLGVS MIWLSPLNDNINRMAGGSAPYHGYWTHDYKRIEEHFGDWKTFKRLVEDAEKRGICIIVDYVPNHSNPATDGELGSLYDNG TLVTNYYYDAKNATVNPYTGSKELIYHHNGDIGDWFGFQLKYANLFGLADFNQLNPWVDSYLKDGARLFVEAGACGFRID AVKHMDLGWLESFYLDLYSSSERPLFIYGEYYSLSPQKTDDMYYFYLYSNVSPLLGIPIRNDIVRTFAYGGSMKDLAREL EDYYSLFVYPNKQVNFLDSHDLVRFLNENHRLDRYHMALALTMTLPGIPVIYYGDESYLVSKDGKGDPYNRPMMVFNNTT EAARIIRTLAELRKTNDALAFGDFRTLYADYNVWAFERAFGAHRLLVVMNKGPDKNLTLSLDWSDGRYVDALHGAEMVVE NGRASVTLPRNSIYIFHVEGEQKEPLIGSLTPYTAQPGQRVLVAGAGFGNDGEVFIGGEKAKVLSWEDDQILVEVPEVET EDSWISVYVETSYGKSNTVKLHYYSSGDVPSLIVVNGSNLTGSLWIKGSLPELAEPRPLIKSSTGYYFTVVPLPNGTIFS VELYRGLPWDELEPLNITLYGRTNSTVLLSTELTEIPTERLTTTSPEMPGKSPDWIPYVALVTIGALLLLLAFRKGRL >Mature_718_residues MKRALVLVFILLLILPSVEAYSVPERGVIYQVMVDRFYDGNQSNNEPFYDPMHTNYRLYWGGDLEGLIEKLDYIQSLGVS MIWLSPLNDNINRMAGGSAPYHGYWTHDYKRIEEHFGDWKTFKRLVEDAEKRGICIIVDYVPNHSNPATDGELGSLYDNG TLVTNYYYDAKNATVNPYTGSKELIYHHNGDIGDWFGFQLKYANLFGLADFNQLNPWVDSYLKDGARLFVEAGACGFRID AVKHMDLGWLESFYLDLYSSSERPLFIYGEYYSLSPQKTDDMYYFYLYSNVSPLLGIPIRNDIVRTFAYGGSMKDLAREL EDYYSLFVYPNKQVNFLDSHDLVRFLNENHRLDRYHMALALTMTLPGIPVIYYGDESYLVSKDGKGDPYNRPMMVFNNTT EAARIIRTLAELRKTNDALAFGDFRTLYADYNVWAFERAFGAHRLLVVMNKGPDKNLTLSLDWSDGRYVDALHGAEMVVE NGRASVTLPRNSIYIFHVEGEQKEPLIGSLTPYTAQPGQRVLVAGAGFGNDGEVFIGGEKAKVLSWEDDQILVEVPEVET EDSWISVYVETSYGKSNTVKLHYYSSGDVPSLIVVNGSNLTGSLWIKGSLPELAEPRPLIKSSTGYYFTVVPLPNGTIFS VELYRGLPWDELEPLNITLYGRTNSTVLLSTELTEIPTERLTTTSPEMPGKSPDWIPYVALVTIGALLLLLAFRKGRL
Specific function: Converts starch into maltose [H]
COG id: COG0366
COG function: function code G; Glycosidases
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 1 IPT/TIG domain [H]
Homologues:
Organism=Escherichia coli, GI1786604, Length=426, Percent_Identity=27.4647887323944, Blast_Score=109, Evalue=5e-25, Organism=Escherichia coli, GI1789995, Length=525, Percent_Identity=22.6666666666667, Blast_Score=95, Evalue=1e-20, Organism=Drosophila melanogaster, GI45549022, Length=241, Percent_Identity=29.045643153527, Blast_Score=83, Evalue=8e-16, Organism=Drosophila melanogaster, GI24586591, Length=190, Percent_Identity=32.1052631578947, Blast_Score=82, Evalue=2e-15, Organism=Drosophila melanogaster, GI221330053, Length=197, Percent_Identity=32.48730964467, Blast_Score=79, Evalue=8e-15, Organism=Drosophila melanogaster, GI24586597, Length=190, Percent_Identity=31.5789473684211, Blast_Score=75, Evalue=2e-13, Organism=Drosophila melanogaster, GI24586599, Length=190, Percent_Identity=30, Blast_Score=75, Evalue=2e-13, Organism=Drosophila melanogaster, GI24586589, Length=389, Percent_Identity=24.4215938303342, Blast_Score=74, Evalue=4e-13, Organism=Drosophila melanogaster, GI24586593, Length=187, Percent_Identity=31.0160427807487, Blast_Score=72, Evalue=1e-12, Organism=Drosophila melanogaster, GI24583747, Length=193, Percent_Identity=29.5336787564767, Blast_Score=72, Evalue=2e-12, Organism=Drosophila melanogaster, GI24583749, Length=193, Percent_Identity=29.5336787564767, Blast_Score=72, Evalue=2e-12, Organism=Drosophila melanogaster, GI24583745, Length=192, Percent_Identity=26.5625, Blast_Score=70, Evalue=4e-12, Organism=Drosophila melanogaster, GI17137384, Length=315, Percent_Identity=26.984126984127, Blast_Score=69, Evalue=2e-11, Organism=Drosophila melanogaster, GI24586587, Length=193, Percent_Identity=27.979274611399, Blast_Score=68, Evalue=2e-11,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR006048 - InterPro: IPR013784 - InterPro: IPR006046 - InterPro: IPR013780 - InterPro: IPR006047 - InterPro: IPR006589 - InterPro: IPR002044 - InterPro: IPR017853 - InterPro: IPR013781 - InterPro: IPR013783 - InterPro: IPR014756 - InterPro: IPR002909 [H]
Pfam domain/function: PF00128 Alpha-amylase; PF02806 Alpha-amylase_C; PF00686 CBM_20; PF01833 TIG [H]
EC number: =3.2.1.133 [H]
Molecular weight: Translated: 81451; Mature: 81451
Theoretical pI: Translated: 4.77; Mature: 4.77
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.3 %Cys (Translated Protein) 2.1 %Met (Translated Protein) 2.4 %Cys+Met (Translated Protein) 0.3 %Cys (Mature Protein) 2.1 %Met (Mature Protein) 2.4 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MKRALVLVFILLLILPSVEAYSVPERGVIYQVMVDRFYDGNQSNNEPFYDPMHTNYRLYW CCHHHHHHHHHHHHHCCCCCCCCCCCCEEEEEEHHHHCCCCCCCCCCCCCCCCCCEEEEE GGDLEGLIEKLDYIQSLGVSMIWLSPLNDNINRMAGGSAPYHGYWTHDYKRIEEHFGDWK CCCHHHHHHHHHHHHHCCCEEEEEECCCCCHHHHCCCCCCCCCEECHHHHHHHHHCCCHH TFKRLVEDAEKRGICIIVDYVPNHSNPATDGELGSLYDNGTLVTNYYYDAKNATVNPYTG HHHHHHHHHHHCCEEEEEEECCCCCCCCCCCCCCCEECCCEEEEEEEEECCCCEECCCCC SKELIYHHNGDIGDWFGFQLKYANLFGLADFNQLNPWVDSYLKDGARLFVEAGACGFRID CCEEEEEECCCCCCCCCEEEEEEEEEECCCCCCCCHHHHHHHCCCEEEEEEECCCCEEEE AVKHMDLGWLESFYLDLYSSSERPLFIYGEYYSLSPQKTDDMYYFYLYSNVSPLLGIPIR CEEECCCHHHHHHHHHHCCCCCCCEEEEEEEEECCCCCCCCEEEEEEECCCCCEEECCCH NDIVRTFAYGGSMKDLARELEDYYSLFVYPNKQVNFLDSHDLVRFLNENHRLDRYHMALA HHHHHHHHCCCCHHHHHHHHHHHEEEEEECCCCEEECCHHHHHHHHCCCCCCCCEEEEEE LTMTLPGIPVIYYGDESYLVSKDGKGDPYNRPMMVFNNTTEAARIIRTLAELRKTNDALA EEEECCCCEEEEECCCEEEEECCCCCCCCCCCEEEECCCHHHHHHHHHHHHHHHCCCCEE FGDFRTLYADYNVWAFERAFGAHRLLVVMNKGPDKNLTLSLDWSDGRYVDALHGAEMVVE ECCEEEEEECCCEEEEHHCCCCEEEEEEEECCCCCCEEEEEECCCCCEEEECCCCEEEEE NGRASVTLPRNSIYIFHVEGEQKEPLIGSLTPYTAQPGQRVLVAGAGFGNDGEVFIGGEK CCCEEEEECCCEEEEEEECCCCCCCCEECCCCCCCCCCCEEEEEECCCCCCCCEEECCCC AKVLSWEDDQILVEVPEVETEDSWISVYVETSYGKSNTVKLHYYSSGDVPSLIVVNGSNL EEEEEECCCEEEEECCCCCCCCCEEEEEEEECCCCCCEEEEEEECCCCCCEEEEEECCCC TGSLWIKGSLPELAEPRPLIKSSTGYYFTVVPLPNGTIFSVELYRGLPWDELEPLNITLY EEEEEEECCCCCCCCCCCCCCCCCCCEEEEEECCCCCEEEEEEECCCCCCCCCCEEEEEE GRTNSTVLLSTELTEIPTERLTTTSPEMPGKSPDWIPYVALVTIGALLLLLAFRKGRL ECCCCEEEEEECHHHCCHHHCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHCCCC >Mature Secondary Structure MKRALVLVFILLLILPSVEAYSVPERGVIYQVMVDRFYDGNQSNNEPFYDPMHTNYRLYW CCHHHHHHHHHHHHHCCCCCCCCCCCCEEEEEEHHHHCCCCCCCCCCCCCCCCCCEEEEE GGDLEGLIEKLDYIQSLGVSMIWLSPLNDNINRMAGGSAPYHGYWTHDYKRIEEHFGDWK CCCHHHHHHHHHHHHHCCCEEEEEECCCCCHHHHCCCCCCCCCEECHHHHHHHHHCCCHH TFKRLVEDAEKRGICIIVDYVPNHSNPATDGELGSLYDNGTLVTNYYYDAKNATVNPYTG HHHHHHHHHHHCCEEEEEEECCCCCCCCCCCCCCCEECCCEEEEEEEEECCCCEECCCCC SKELIYHHNGDIGDWFGFQLKYANLFGLADFNQLNPWVDSYLKDGARLFVEAGACGFRID CCEEEEEECCCCCCCCCEEEEEEEEEECCCCCCCCHHHHHHHCCCEEEEEEECCCCEEEE AVKHMDLGWLESFYLDLYSSSERPLFIYGEYYSLSPQKTDDMYYFYLYSNVSPLLGIPIR CEEECCCHHHHHHHHHHCCCCCCCEEEEEEEEECCCCCCCCEEEEEEECCCCCEEECCCH NDIVRTFAYGGSMKDLARELEDYYSLFVYPNKQVNFLDSHDLVRFLNENHRLDRYHMALA HHHHHHHHCCCCHHHHHHHHHHHEEEEEECCCCEEECCHHHHHHHHCCCCCCCCEEEEEE LTMTLPGIPVIYYGDESYLVSKDGKGDPYNRPMMVFNNTTEAARIIRTLAELRKTNDALA EEEECCCCEEEEECCCEEEEECCCCCCCCCCCEEEECCCHHHHHHHHHHHHHHHCCCCEE FGDFRTLYADYNVWAFERAFGAHRLLVVMNKGPDKNLTLSLDWSDGRYVDALHGAEMVVE ECCEEEEEECCCEEEEHHCCCCEEEEEEEECCCCCCEEEEEECCCCCEEEECCCCEEEEE NGRASVTLPRNSIYIFHVEGEQKEPLIGSLTPYTAQPGQRVLVAGAGFGNDGEVFIGGEK CCCEEEEECCCEEEEEEECCCCCCCCEECCCCCCCCCCCEEEEEECCCCCCCCEEECCCC AKVLSWEDDQILVEVPEVETEDSWISVYVETSYGKSNTVKLHYYSSGDVPSLIVVNGSNL EEEEEECCCEEEEECCCCCCCCCEEEEEEEECCCCCCEEEEEEECCCCCCEEEEEECCCC TGSLWIKGSLPELAEPRPLIKSSTGYYFTVVPLPNGTIFSVELYRGLPWDELEPLNITLY EEEEEEECCCCCCCCCCCCCCCCCCCEEEEEECCCCCEEEEEEECCCCCCCCCCEEEEEE GRTNSTVLLSTELTEIPTERLTTTSPEMPGKSPDWIPYVALVTIGALLLLLAFRKGRL ECCCCEEEEEECHHHCCHHHCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHCCCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 10387084 [H]