Definition Exiguobacterium sp. AT1b, complete genome.
Accession NC_012673
Length 2,999,895

Click here to switch to the map view.

The map label for this gene is malL [H]

Identifier: 229916992

GI number: 229916992

Start: 1240720

End: 1242330

Strand: Reverse

Name: malL [H]

Synonym: EAT1b_1266

Alternate gene names: 229916992

Gene position: 1242330-1240720 (Counterclockwise)

Preceding gene: 229916993

Following gene: 229916988

Centisome position: 41.41

GC content: 41.53

Gene sequence:

>1611_bases
ATGAAACGGACATGGTGGAAAGAGGCCGTCGTATATCAAGTGTATTGGCGAAGCTTTTTCGATACAGATGGAGATGGATA
TGGTGACTTAGAAGGTGTACGTCAAAAGTTACCGTATATTAAAGAACTTGGGGCGGATGTTGTCTGGCTCAATCCGTTCT
ATGTGTCGCCTGATAAGGACAACGGATATGACATTGCCGACTATTATGGTGTCATGGATCGAGCAGGAACGATGGCGGAT
TTTGAACGTTTGTTGAAAGAGGCGCACGCACTCGGTCTGAAAGTCATTTTGGATCTTGTCGTTAACCATACTTCGAATCA
ACACCAGTGGTTCTTGGAATCAAAGAAGGGTAAAGACTCACCAAAGCGAGATTACTACATCTGGCATGACCCAGTGCAAG
GGAAAGCGCCAAACAATTGGCGATCATATTTTGAGCCGTCTTGTTGGGAATGGGATAAGCACAGCGGTCAGTATTATTAC
CATTCATTCGCCGTCGAACAACCCGATCTCAATTGGGAAAATAAAGAATTGCGTCATGAAATCTATAAGATGATGCGTTT
TTGGCTCGACAAAGGTATTGATGGATTCCGAATGGATGTCATCAATCTTCTCGCAAAACGCAAAGACTTATCTGATGTCG
AAGATCCATATAATTTGAGTTACTTAGCTAATAATCCGGGGATTCATGAGTATCTTCAAGAAATGCATGAGGAAGTACTA
GGAAACTATAATTGTATGACTGTCGGTGAGATACCGTTCGTTACACCGAAAGAAGGCGCACTCTATGTAGATGAGGAACG
TCAAGAGCTCAATACGTTGTTCCATTTTCAAATCGCTGATGAGATGCCGACTTGGGATATGCTTCGTTTTAAAGAAATTC
AGCGTGAATGGTACGAAGGGTTGAAAGGTAGAGGATGGAATTCACAGTTCTTAAACAATCACGATCACACGCGTCAGGTT
ACTCGTTATGGGAATGATAGGGAACATCGAGTTGCCTCGGCAAAACTGCTAGCTACCTTGACGCACACATTGCCTGGTAT
GCCTTATATCTATCAAGGAGAAGAAATCGGAATGACTGGTGTCACGTTTGATTCGATTGAAGATTATCAAGATATTGCGA
TGAAGAATCGGTATGCAGAAGAAGTGGATAAGGGACGAAATGAGAATGAAGTATTGGTCAGTTTGCAACTATTGAGTAGA
GATAACTCACGGACGCCTATGCAATGGAACGACAAAAAAGAAGCTGGATTTACACAAGGAATACCTTGGATGAGCGTGAA
TAAAAATTACGTCGAGTTGAACGTAGAGAAAGATATGCAACGGGAGGATTCTGTGTTCCGTTACTATCAACGTTTGATTC
AATTGAGGAAATCAAATGAAGCACTTGTATATGGTGATTTTAAAGATTTACTTCCATCTGACGAATCGCTTCATGTATAT
GAGCGTTCTCTGAGAGAAGAACAATTTTTGATCATTCTCAATCATTCAGAGGATTCTCATCCGATACCCGTACCGACAGC
ATCTTTTGATCTCGTCTTACAAAATCTAAACAATGAGACTAGTCAATTGCAACCGTATGAGGCAAGGATTTATAAGAAGA
CCATCGAATAG

Upstream 100 bases:

>100_bases
AAACACAGCGCGTCTCACATTAGAGAAGCTATTGGTTCGAATTTAAAAACGAAGCCTCGAGTGTTAACGCTCGAGGCATT
TTTAATGAGGGGGAGTCGGA

Downstream 100 bases:

>100_bases
GTGGTCTTCACGCTTTTTTCTTCGTTCCTCGAAACGCAAAAAACATAGCGATGCCAATTGCGATTCCGACCCACCAGTTA
TCGAGGGTGAGACCAAAGAC

Product: alpha amylase catalytic region

Products: NA

Alternate protein names: Dextrin 6-alpha-D-glucanohydrolase; Oligosaccharide alpha-1,6-glucosidase; Sucrase-isomaltase; Isomaltase [H]

Number of amino acids: Translated: 536; Mature: 536

Protein sequence:

>536_residues
MKRTWWKEAVVYQVYWRSFFDTDGDGYGDLEGVRQKLPYIKELGADVVWLNPFYVSPDKDNGYDIADYYGVMDRAGTMAD
FERLLKEAHALGLKVILDLVVNHTSNQHQWFLESKKGKDSPKRDYYIWHDPVQGKAPNNWRSYFEPSCWEWDKHSGQYYY
HSFAVEQPDLNWENKELRHEIYKMMRFWLDKGIDGFRMDVINLLAKRKDLSDVEDPYNLSYLANNPGIHEYLQEMHEEVL
GNYNCMTVGEIPFVTPKEGALYVDEERQELNTLFHFQIADEMPTWDMLRFKEIQREWYEGLKGRGWNSQFLNNHDHTRQV
TRYGNDREHRVASAKLLATLTHTLPGMPYIYQGEEIGMTGVTFDSIEDYQDIAMKNRYAEEVDKGRNENEVLVSLQLLSR
DNSRTPMQWNDKKEAGFTQGIPWMSVNKNYVELNVEKDMQREDSVFRYYQRLIQLRKSNEALVYGDFKDLLPSDESLHVY
ERSLREEQFLIILNHSEDSHPIPVPTASFDLVLQNLNNETSQLQPYEARIYKKTIE

Sequences:

>Translated_536_residues
MKRTWWKEAVVYQVYWRSFFDTDGDGYGDLEGVRQKLPYIKELGADVVWLNPFYVSPDKDNGYDIADYYGVMDRAGTMAD
FERLLKEAHALGLKVILDLVVNHTSNQHQWFLESKKGKDSPKRDYYIWHDPVQGKAPNNWRSYFEPSCWEWDKHSGQYYY
HSFAVEQPDLNWENKELRHEIYKMMRFWLDKGIDGFRMDVINLLAKRKDLSDVEDPYNLSYLANNPGIHEYLQEMHEEVL
GNYNCMTVGEIPFVTPKEGALYVDEERQELNTLFHFQIADEMPTWDMLRFKEIQREWYEGLKGRGWNSQFLNNHDHTRQV
TRYGNDREHRVASAKLLATLTHTLPGMPYIYQGEEIGMTGVTFDSIEDYQDIAMKNRYAEEVDKGRNENEVLVSLQLLSR
DNSRTPMQWNDKKEAGFTQGIPWMSVNKNYVELNVEKDMQREDSVFRYYQRLIQLRKSNEALVYGDFKDLLPSDESLHVY
ERSLREEQFLIILNHSEDSHPIPVPTASFDLVLQNLNNETSQLQPYEARIYKKTIE
>Mature_536_residues
MKRTWWKEAVVYQVYWRSFFDTDGDGYGDLEGVRQKLPYIKELGADVVWLNPFYVSPDKDNGYDIADYYGVMDRAGTMAD
FERLLKEAHALGLKVILDLVVNHTSNQHQWFLESKKGKDSPKRDYYIWHDPVQGKAPNNWRSYFEPSCWEWDKHSGQYYY
HSFAVEQPDLNWENKELRHEIYKMMRFWLDKGIDGFRMDVINLLAKRKDLSDVEDPYNLSYLANNPGIHEYLQEMHEEVL
GNYNCMTVGEIPFVTPKEGALYVDEERQELNTLFHFQIADEMPTWDMLRFKEIQREWYEGLKGRGWNSQFLNNHDHTRQV
TRYGNDREHRVASAKLLATLTHTLPGMPYIYQGEEIGMTGVTFDSIEDYQDIAMKNRYAEEVDKGRNENEVLVSLQLLSR
DNSRTPMQWNDKKEAGFTQGIPWMSVNKNYVELNVEKDMQREDSVFRYYQRLIQLRKSNEALVYGDFKDLLPSDESLHVY
ERSLREEQFLIILNHSEDSHPIPVPTASFDLVLQNLNNETSQLQPYEARIYKKTIE

Specific function: Unknown

COG id: COG0366

COG function: function code G; Glycosidases

Gene ontology:

Cell location: Cytoplasm [H]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the glycosyl hydrolase 13 family [H]

Homologues:

Organism=Homo sapiens, GI187423904, Length=558, Percent_Identity=30.8243727598566, Blast_Score=237, Evalue=2e-62,
Organism=Escherichia coli, GI1790687, Length=540, Percent_Identity=42.5925925925926, Blast_Score=444, Evalue=1e-126,
Organism=Escherichia coli, GI1786604, Length=386, Percent_Identity=27.720207253886, Blast_Score=102, Evalue=6e-23,
Organism=Caenorhabditis elegans, GI25147709, Length=529, Percent_Identity=24.1965973534972, Blast_Score=120, Evalue=2e-27,
Organism=Caenorhabditis elegans, GI32565753, Length=488, Percent_Identity=22.7459016393443, Blast_Score=104, Evalue=1e-22,
Organism=Saccharomyces cerevisiae, GI6321726, Length=578, Percent_Identity=37.5432525951557, Blast_Score=365, Evalue=1e-102,
Organism=Saccharomyces cerevisiae, GI6322245, Length=573, Percent_Identity=36.8237347294939, Blast_Score=362, Evalue=1e-101,
Organism=Saccharomyces cerevisiae, GI6319776, Length=573, Percent_Identity=37.8708551483421, Blast_Score=357, Evalue=4e-99,
Organism=Saccharomyces cerevisiae, GI6321731, Length=573, Percent_Identity=37.8708551483421, Blast_Score=356, Evalue=5e-99,
Organism=Saccharomyces cerevisiae, GI6324416, Length=577, Percent_Identity=37.7816291161178, Blast_Score=356, Evalue=6e-99,
Organism=Saccharomyces cerevisiae, GI6322241, Length=577, Percent_Identity=37.6083188908146, Blast_Score=354, Evalue=2e-98,
Organism=Saccharomyces cerevisiae, GI6322021, Length=577, Percent_Identity=37.6083188908146, Blast_Score=354, Evalue=2e-98,
Organism=Drosophila melanogaster, GI221330053, Length=532, Percent_Identity=33.2706766917293, Blast_Score=271, Evalue=1e-72,
Organism=Drosophila melanogaster, GI24586599, Length=524, Percent_Identity=33.206106870229, Blast_Score=270, Evalue=2e-72,
Organism=Drosophila melanogaster, GI24586593, Length=577, Percent_Identity=32.2357019064125, Blast_Score=263, Evalue=3e-70,
Organism=Drosophila melanogaster, GI24586597, Length=500, Percent_Identity=33.6, Blast_Score=261, Evalue=1e-69,
Organism=Drosophila melanogaster, GI24583747, Length=522, Percent_Identity=34.0996168582375, Blast_Score=259, Evalue=3e-69,
Organism=Drosophila melanogaster, GI24583745, Length=519, Percent_Identity=34.1040462427746, Blast_Score=259, Evalue=3e-69,
Organism=Drosophila melanogaster, GI24583749, Length=522, Percent_Identity=34.0996168582375, Blast_Score=259, Evalue=3e-69,
Organism=Drosophila melanogaster, GI24586591, Length=483, Percent_Identity=35.1966873706004, Blast_Score=254, Evalue=8e-68,
Organism=Drosophila melanogaster, GI24586589, Length=552, Percent_Identity=32.0652173913043, Blast_Score=250, Evalue=2e-66,
Organism=Drosophila melanogaster, GI45549022, Length=537, Percent_Identity=30.7262569832402, Blast_Score=243, Evalue=3e-64,
Organism=Drosophila melanogaster, GI24586587, Length=541, Percent_Identity=30.1293900184843, Blast_Score=232, Evalue=5e-61,
Organism=Drosophila melanogaster, GI281360393, Length=522, Percent_Identity=30.0766283524904, Blast_Score=195, Evalue=7e-50,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR013780
- InterPro:   IPR006047
- InterPro:   IPR006589
- InterPro:   IPR017853
- InterPro:   IPR013781 [H]

Pfam domain/function: PF00128 Alpha-amylase [H]

EC number: =3.2.1.10 [H]

Molecular weight: Translated: 63483; Mature: 63483

Theoretical pI: Translated: 4.94; Mature: 4.94

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.4 %Cys     (Translated Protein)
3.0 %Met     (Translated Protein)
3.4 %Cys+Met (Translated Protein)
0.4 %Cys     (Mature Protein)
3.0 %Met     (Mature Protein)
3.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKRTWWKEAVVYQVYWRSFFDTDGDGYGDLEGVRQKLPYIKELGADVVWLNPFYVSPDKD
CCCCHHHHHHHHHHHHHHHCCCCCCCCCCHHHHHHHCCHHHHCCCCEEEECCEEECCCCC
NGYDIADYYGVMDRAGTMADFERLLKEAHALGLKVILDLVVNHTSNQHQWFLESKKGKDS
CCCCHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCEEEEECCCCCCC
PKRDYYIWHDPVQGKAPNNWRSYFEPSCWEWDKHSGQYYYHSFAVEQPDLNWENKELRHE
CCCCEEEEECCCCCCCCCCHHHHCCCCCCCCCCCCCCEEEEEEEEECCCCCCCHHHHHHH
IYKMMRFWLDKGIDGFRMDVINLLAKRKDLSDVEDPYNLSYLANNPGIHEYLQEMHEEVL
HHHHHHHHHHCCCCHHHHHHHHHHHHHCCCCCCCCCCCEEEEECCCCHHHHHHHHHHHHH
GNYNCMTVGEIPFVTPKEGALYVDEERQELNTLFHFQIADEMPTWDMLRFKEIQREWYEG
CCCCEEEECCCCCCCCCCCCEEECHHHHHHHHEEEEEECCCCCCHHHHHHHHHHHHHHHH
LKGRGWNSQFLNNHDHTRQVTRYGNDREHRVASAKLLATLTHTLPGMPYIYQGEEIGMTG
HCCCCCCHHHCCCCHHHHHHHHCCCCHHHHHHHHHHHHHHHHHCCCCCEEEECCCCCCCC
VTFDSIEDYQDIAMKNRYAEEVDKGRNENEVLVSLQLLSRDNSRTPMQWNDKKEAGFTQG
CCHHHHHHHHHHHHHHHHHHHHHCCCCCCCEEEEEEECCCCCCCCCCCCCCCCCCCCCCC
IPWMSVNKNYVELNVEKDMQREDSVFRYYQRLIQLRKSNEALVYGDFKDLLPSDESLHVY
CCCEECCCCEEEEEEHHHHHHHHHHHHHHHHHHHHHCCCCEEEEECHHHHCCCCCCHHHH
ERSLREEQFLIILNHSEDSHPIPVPTASFDLVLQNLNNETSQLQPYEARIYKKTIE
HHHCCCCEEEEEEECCCCCCCCCCCCCHHHHHHHHCCCCHHHCCCHHHHHHHHHCC
>Mature Secondary Structure
MKRTWWKEAVVYQVYWRSFFDTDGDGYGDLEGVRQKLPYIKELGADVVWLNPFYVSPDKD
CCCCHHHHHHHHHHHHHHHCCCCCCCCCCHHHHHHHCCHHHHCCCCEEEECCEEECCCCC
NGYDIADYYGVMDRAGTMADFERLLKEAHALGLKVILDLVVNHTSNQHQWFLESKKGKDS
CCCCHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCEEEEECCCCCCC
PKRDYYIWHDPVQGKAPNNWRSYFEPSCWEWDKHSGQYYYHSFAVEQPDLNWENKELRHE
CCCCEEEEECCCCCCCCCCHHHHCCCCCCCCCCCCCCEEEEEEEEECCCCCCCHHHHHHH
IYKMMRFWLDKGIDGFRMDVINLLAKRKDLSDVEDPYNLSYLANNPGIHEYLQEMHEEVL
HHHHHHHHHHCCCCHHHHHHHHHHHHHCCCCCCCCCCCEEEEECCCCHHHHHHHHHHHHH
GNYNCMTVGEIPFVTPKEGALYVDEERQELNTLFHFQIADEMPTWDMLRFKEIQREWYEG
CCCCEEEECCCCCCCCCCCCEEECHHHHHHHHEEEEEECCCCCCHHHHHHHHHHHHHHHH
LKGRGWNSQFLNNHDHTRQVTRYGNDREHRVASAKLLATLTHTLPGMPYIYQGEEIGMTG
HCCCCCCHHHCCCCHHHHHHHHCCCCHHHHHHHHHHHHHHHHHCCCCCEEEECCCCCCCC
VTFDSIEDYQDIAMKNRYAEEVDKGRNENEVLVSLQLLSRDNSRTPMQWNDKKEAGFTQG
CCHHHHHHHHHHHHHHHHHHHHHCCCCCCCEEEEEEECCCCCCCCCCCCCCCCCCCCCCC
IPWMSVNKNYVELNVEKDMQREDSVFRYYQRLIQLRKSNEALVYGDFKDLLPSDESLHVY
CCCEECCCCEEEEEEHHHHHHHHHHHHHHHHHHHHHCCCCEEEEECHHHHCCCCCCHHHH
ERSLREEQFLIILNHSEDSHPIPVPTASFDLVLQNLNNETSQLQPYEARIYKKTIE
HHHCCCCEEEEEEECCCCCCCCCCCCCHHHHHHHHCCCCHHHCCCHHHHHHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 1761534 [H]