Definition Eubacterium eligens ATCC 27750 chromosome, complete genome.
Accession NC_012778
Length 2,144,190

Click here to switch to the map view.

The map label for this gene is tvaI [H]

Identifier: 238917786

GI number: 238917786

Start: 1929036

End: 1931150

Strand: Reverse

Name: tvaI [H]

Synonym: EUBELI_01867

Alternate gene names: 238917786

Gene position: 1931150-1929036 (Counterclockwise)

Preceding gene: 238917787

Following gene: 238917785

Centisome position: 90.06

GC content: 39.91

Gene sequence:

>2115_bases
ATGAGAATAACCGGGGAAATGGGAAACTTAGCTGCCTGGGAAAAAAGACTTTTTTATATGTGCAGTGCAAGACCAACGCT
ACACCCAAGAGCGTTGTTTTCGGATGTTACAAGTGATTACAGAAATCCGGCAGAGCCAGAGCCGGGTGATGAGGTGACTA
TAAGACTGCGTACTGGAAGATATAATGTTGATAAAGCATATCTGGTTGTGGATAATGTTGAACGTGTTATGACAAGAGTA
AGATCAGAGAGCCTGTTCGATTATTATGAAGCTAAGATTAATGTCGGAACTGACAAAATATATTATTATTTTAAGGTAGA
GCTTGGCAGAACGGTGTGTTATTACAATCAGATTGGGGCGATTAAAGAGCTTAATCCGTATTATAATTTCCAGATTACAC
CAGGTTTTAAGACACCTGCATGGGCAAAGGGTGCTGTTATGTACCAGATATTTGTTGACAGGTTCTGCAATGGTGATAAA
AGCAATGATGTTCTTGATGATGAATATAACTATATAGGAGAGCATGTCTGTCAGGTTAAGGACTGGAATAAGTATCCTGC
ACAGATGGGAATAAGAGAGTTTTATGGAGGCGACCTTAAGGGTGTGCTTGATAAGCTTGATTATTTACAGGAATTAGGAG
TTGAGGTTATATATTTTAATCCGTTATTTGTATCGCCTTCTAATCATAAGTATGATATACAGGACTATGACTATATTGAC
CCACATTTTGGCGTAATTGTGGACGATGAAGGAGAAGTGCTGAGAGAGGGTGACACTGATAATACCCATGCGACGAGATA
TATTAGCAGAGTTACAAGAAAGTCGAACCTTGAGGCTAGCAATGATTTTTTTGCAAAGGTTGTGCAGGAAATTCATTCAA
GAGGCATGAAGGTTATTATAGATGGAGTGTTTAACCACTGTGGTTCATTCAACAAGTGGCTGGATAAGGAACACATTTAC
AGGGACAGTGCAGATGAATATGCACCGGGAGCTTATGAAAGGTATGAAAGTCCATACCACAATTTCTTTAAGTTTTATTC
AAACCAGTGGCCTGATAATAATTCGTATGACGGCTGGTGGGGACATGATACACTTCCTAAGCTTAATTATGAGGGCTCTA
AAGAGCTTGAAGAATATATTCTATCTATCGGCAGGAAATGGGTTTCTGCGCCTTATAATGTTGATGGATGGAGACTTGAT
GTGGCGGCTGACTTAGGCTACAGTCCTGAATATAACCATTATTTCTGGAAGAGATTCCGGGAAGAGGTTAAGAAGGCTAA
TCCTGATGCTATTATTCTTGCAGAACATTATGGTGATTCATATGAATGGCTGCAGGGTGATGAATGGGATACCATTATGA
ATTATGATGCTTTTATGGAGCCTGTTACATGGTTCCTTACAGGAATGGAAAAGCACAGTGATGAGGCAAGACCTGACTCA
TACGGTAACCCAGACTATTTCTTTGGTGCCATGCATCATAATATGGCAAGAATGGGCGGACAGAGTGTTGCAATATCTAT
GAATGAACTGTCTAATCATGATCATTCAAGGTTTTTAACAAGAACTAACAGGACCGTTGGAAGAACTAATACACTGGGAC
CGGAGGCTGCCAATAATAATGTCAACAAGGCAGTGTTTAAAGAGGCTGTTGTTATGCAGATGACATTACCAGGTGCGCCT
ACTGTATATTATGGCGATGAAGCAGGTGTGTGTGGATTCACTGATCCTGATAACAGAAGAACTTATCCATGGGGACATGA
GGATACGGAACTGATTGATTTCCATAGGACTGCAATAAAGATGCATAAAGAGAATGATGTATTAAGAAAAGGCTCATATA
AGTCACTGTATTCAGCATATAATGTTGTTGCATATGGAAGGTTTACAAGTGATGACGCTGCAATCATTATTGTTAATAAT
AACGATGATGAGGTGAGAGCCAGAATTCCTGCATGGGAAGTTGGTCTTGGTTTTGATGATGATGTTGAGCAGCTGTTAGT
TACATTTGAAGGTGGATACAGTACAGACAGGCTTGGTTATCACCTTCAGAATGGCTGGCTTGATATTGGATTAAGAAAGA
CTTCAGCTGTGGTTCTTCATAAGATGAAGTGGTGA

Upstream 100 bases:

>100_bases
CCCCATGGCTGCCTTTTTTGCTGTTTAAAAATCCTTTTCACTTGCTAAAATGTACTTTTAGATATAAAATCAGAATAGTA
TATGCTAAGGAGGATTCTCT

Downstream 100 bases:

>100_bases
TGCTGTATGTTGTATTTGCACAAGGGCAGGACTAATGTTATAATGCAATGAGACAGCATCGAAACAGAAAGGAATATTAT
AATGGAATCATATAATTCTA

Product: glycoside hydrolase family 13 protein

Products: NA

Alternate protein names: Alpha-amylase I; TVA I [H]

Number of amino acids: Translated: 704; Mature: 704

Protein sequence:

>704_residues
MRITGEMGNLAAWEKRLFYMCSARPTLHPRALFSDVTSDYRNPAEPEPGDEVTIRLRTGRYNVDKAYLVVDNVERVMTRV
RSESLFDYYEAKINVGTDKIYYYFKVELGRTVCYYNQIGAIKELNPYYNFQITPGFKTPAWAKGAVMYQIFVDRFCNGDK
SNDVLDDEYNYIGEHVCQVKDWNKYPAQMGIREFYGGDLKGVLDKLDYLQELGVEVIYFNPLFVSPSNHKYDIQDYDYID
PHFGVIVDDEGEVLREGDTDNTHATRYISRVTRKSNLEASNDFFAKVVQEIHSRGMKVIIDGVFNHCGSFNKWLDKEHIY
RDSADEYAPGAYERYESPYHNFFKFYSNQWPDNNSYDGWWGHDTLPKLNYEGSKELEEYILSIGRKWVSAPYNVDGWRLD
VAADLGYSPEYNHYFWKRFREEVKKANPDAIILAEHYGDSYEWLQGDEWDTIMNYDAFMEPVTWFLTGMEKHSDEARPDS
YGNPDYFFGAMHHNMARMGGQSVAISMNELSNHDHSRFLTRTNRTVGRTNTLGPEAANNNVNKAVFKEAVVMQMTLPGAP
TVYYGDEAGVCGFTDPDNRRTYPWGHEDTELIDFHRTAIKMHKENDVLRKGSYKSLYSAYNVVAYGRFTSDDAAIIIVNN
NDDEVRARIPAWEVGLGFDDDVEQLLVTFEGGYSTDRLGYHLQNGWLDIGLRKTSAVVLHKMKW

Sequences:

>Translated_704_residues
MRITGEMGNLAAWEKRLFYMCSARPTLHPRALFSDVTSDYRNPAEPEPGDEVTIRLRTGRYNVDKAYLVVDNVERVMTRV
RSESLFDYYEAKINVGTDKIYYYFKVELGRTVCYYNQIGAIKELNPYYNFQITPGFKTPAWAKGAVMYQIFVDRFCNGDK
SNDVLDDEYNYIGEHVCQVKDWNKYPAQMGIREFYGGDLKGVLDKLDYLQELGVEVIYFNPLFVSPSNHKYDIQDYDYID
PHFGVIVDDEGEVLREGDTDNTHATRYISRVTRKSNLEASNDFFAKVVQEIHSRGMKVIIDGVFNHCGSFNKWLDKEHIY
RDSADEYAPGAYERYESPYHNFFKFYSNQWPDNNSYDGWWGHDTLPKLNYEGSKELEEYILSIGRKWVSAPYNVDGWRLD
VAADLGYSPEYNHYFWKRFREEVKKANPDAIILAEHYGDSYEWLQGDEWDTIMNYDAFMEPVTWFLTGMEKHSDEARPDS
YGNPDYFFGAMHHNMARMGGQSVAISMNELSNHDHSRFLTRTNRTVGRTNTLGPEAANNNVNKAVFKEAVVMQMTLPGAP
TVYYGDEAGVCGFTDPDNRRTYPWGHEDTELIDFHRTAIKMHKENDVLRKGSYKSLYSAYNVVAYGRFTSDDAAIIIVNN
NDDEVRARIPAWEVGLGFDDDVEQLLVTFEGGYSTDRLGYHLQNGWLDIGLRKTSAVVLHKMKW
>Mature_704_residues
MRITGEMGNLAAWEKRLFYMCSARPTLHPRALFSDVTSDYRNPAEPEPGDEVTIRLRTGRYNVDKAYLVVDNVERVMTRV
RSESLFDYYEAKINVGTDKIYYYFKVELGRTVCYYNQIGAIKELNPYYNFQITPGFKTPAWAKGAVMYQIFVDRFCNGDK
SNDVLDDEYNYIGEHVCQVKDWNKYPAQMGIREFYGGDLKGVLDKLDYLQELGVEVIYFNPLFVSPSNHKYDIQDYDYID
PHFGVIVDDEGEVLREGDTDNTHATRYISRVTRKSNLEASNDFFAKVVQEIHSRGMKVIIDGVFNHCGSFNKWLDKEHIY
RDSADEYAPGAYERYESPYHNFFKFYSNQWPDNNSYDGWWGHDTLPKLNYEGSKELEEYILSIGRKWVSAPYNVDGWRLD
VAADLGYSPEYNHYFWKRFREEVKKANPDAIILAEHYGDSYEWLQGDEWDTIMNYDAFMEPVTWFLTGMEKHSDEARPDS
YGNPDYFFGAMHHNMARMGGQSVAISMNELSNHDHSRFLTRTNRTVGRTNTLGPEAANNNVNKAVFKEAVVMQMTLPGAP
TVYYGDEAGVCGFTDPDNRRTYPWGHEDTELIDFHRTAIKMHKENDVLRKGSYKSLYSAYNVVAYGRFTSDDAAIIIVNN
NDDEVRARIPAWEVGLGFDDDVEQLLVTFEGGYSTDRLGYHLQNGWLDIGLRKTSAVVLHKMKW

Specific function: Endohydrolysis of 1,4-alpha-glucosidic linkages in pullulan to form panose. Also hydrolyzes cyclodextrins [H]

COG id: COG0366

COG function: function code G; Glycosidases

Gene ontology:

Cell location: Secreted [H]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the glycosyl hydrolase 13 family [H]

Homologues:

Organism=Escherichia coli, GI1786604, Length=518, Percent_Identity=32.4324324324324, Blast_Score=251, Evalue=2e-67,
Organism=Escherichia coli, GI1790687, Length=229, Percent_Identity=27.9475982532751, Blast_Score=76, Evalue=9e-15,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR013780
- InterPro:   IPR006047
- InterPro:   IPR004185
- InterPro:   IPR006589
- InterPro:   IPR017853
- InterPro:   IPR013781
- InterPro:   IPR013783
- InterPro:   IPR014756 [H]

Pfam domain/function: PF00128 Alpha-amylase; PF02903 Alpha-amylase_N [H]

EC number: =3.2.1.135 [H]

Molecular weight: Translated: 81574; Mature: 81574

Theoretical pI: Translated: 5.00; Mature: 5.00

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.9 %Cys     (Translated Protein)
2.6 %Met     (Translated Protein)
3.4 %Cys+Met (Translated Protein)
0.9 %Cys     (Mature Protein)
2.6 %Met     (Mature Protein)
3.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MRITGEMGNLAAWEKRLFYMCSARPTLHPRALFSDVTSDYRNPAEPEPGDEVTIRLRTGR
CEECCCCCCHHHHHHHHHEEECCCCCCCHHHHHHHHHHHCCCCCCCCCCCEEEEEEECCC
YNVDKAYLVVDNVERVMTRVRSESLFDYYEAKINVGTDKIYYYFKVELGRTVCYYNQIGA
CCCCEEEEEECCHHHHHHHHHHHHHHHHHHEEEECCCCEEEEEEEEEECCEEEEECCCCC
IKELNPYYNFQITPGFKTPAWAKGAVMYQIFVDRFCNGDKSNDVLDDEYNYIGEHVCQVK
CEECCCCEEEEECCCCCCCCCCCCHHHHHHHHHHHCCCCCCCCCCCCHHHHHHHHHHHCC
DWNKYPAQMGIREFYGGDLKGVLDKLDYLQELGVEVIYFNPLFVSPSNHKYDIQDYDYID
CCCCCCHHHCHHHHHCCCHHHHHHHHHHHHHCCCEEEEEEEEEECCCCCEECCCCCCCCC
PHFGVIVDDEGEVLREGDTDNTHATRYISRVTRKSNLEASNDFFAKVVQEIHSRGMKVII
CCCCEEECCCCCCEECCCCCCHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHCCCEEEE
DGVFNHCGSFNKWLDKEHIYRDSADEYAPGAYERYESPYHNFFKFYSNQWPDNNSYDGWW
EHHHHHCCCHHHHHCHHHHHCCCCCCCCCCHHHHHCCHHHHHHHHHCCCCCCCCCCCCCC
GHDTLPKLNYEGSKELEEYILSIGRKWVSAPYNVDGWRLDVAADLGYSPEYNHYFWKRFR
CCCCCCCCCCCCHHHHHHHHHHHHHHHHCCCCCCCCEEEEEEECCCCCCCCCHHHHHHHH
EEVKKANPDAIILAEHYGDSYEWLQGDEWDTIMNYDAFMEPVTWFLTGMEKHSDEARPDS
HHHHHCCCCEEEEEECCCCCCCCCCCCCCCHHCCCHHHHHHHHHHHHHHHHCCCCCCCCC
YGNPDYFFGAMHHNMARMGGQSVAISMNELSNHDHSRFLTRTNRTVGRTNTLGPEAANNN
CCCCCEEEEHHHHHHHHCCCCEEEEEHHHHCCCCHHHHHHHCCCCCCCCCCCCCCCCCCC
VNKAVFKEAVVMQMTLPGAPTVYYGDEAGVCGFTDPDNRRTYPWGHEDTELIDFHRTAIK
CHHHHHHHHHEEEEECCCCCEEEECCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHH
MHKENDVLRKGSYKSLYSAYNVVAYGRFTSDDAAIIIVNNNDDEVRARIPAWEVGLGFDD
HHCCCCHHHCCCHHHHHHHHCEEEEEEECCCCCEEEEEECCCCCEEEECCEEEECCCCCC
DVEQLLVTFEGGYSTDRLGYHLQNGWLDIGLRKTSAVVLHKMKW
CHHHEEEEECCCCCCCCCCEEECCCEEEEEECHHHEEEEEECCC
>Mature Secondary Structure
MRITGEMGNLAAWEKRLFYMCSARPTLHPRALFSDVTSDYRNPAEPEPGDEVTIRLRTGR
CEECCCCCCHHHHHHHHHEEECCCCCCCHHHHHHHHHHHCCCCCCCCCCCEEEEEEECCC
YNVDKAYLVVDNVERVMTRVRSESLFDYYEAKINVGTDKIYYYFKVELGRTVCYYNQIGA
CCCCEEEEEECCHHHHHHHHHHHHHHHHHHEEEECCCCEEEEEEEEEECCEEEEECCCCC
IKELNPYYNFQITPGFKTPAWAKGAVMYQIFVDRFCNGDKSNDVLDDEYNYIGEHVCQVK
CEECCCCEEEEECCCCCCCCCCCCHHHHHHHHHHHCCCCCCCCCCCCHHHHHHHHHHHCC
DWNKYPAQMGIREFYGGDLKGVLDKLDYLQELGVEVIYFNPLFVSPSNHKYDIQDYDYID
CCCCCCHHHCHHHHHCCCHHHHHHHHHHHHHCCCEEEEEEEEEECCCCCEECCCCCCCCC
PHFGVIVDDEGEVLREGDTDNTHATRYISRVTRKSNLEASNDFFAKVVQEIHSRGMKVII
CCCCEEECCCCCCEECCCCCCHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHCCCEEEE
DGVFNHCGSFNKWLDKEHIYRDSADEYAPGAYERYESPYHNFFKFYSNQWPDNNSYDGWW
EHHHHHCCCHHHHHCHHHHHCCCCCCCCCCHHHHHCCHHHHHHHHHCCCCCCCCCCCCCC
GHDTLPKLNYEGSKELEEYILSIGRKWVSAPYNVDGWRLDVAADLGYSPEYNHYFWKRFR
CCCCCCCCCCCCHHHHHHHHHHHHHHHHCCCCCCCCEEEEEEECCCCCCCCCHHHHHHHH
EEVKKANPDAIILAEHYGDSYEWLQGDEWDTIMNYDAFMEPVTWFLTGMEKHSDEARPDS
HHHHHCCCCEEEEEECCCCCCCCCCCCCCCHHCCCHHHHHHHHHHHHHHHHCCCCCCCCC
YGNPDYFFGAMHHNMARMGGQSVAISMNELSNHDHSRFLTRTNRTVGRTNTLGPEAANNN
CCCCCEEEEHHHHHHHHCCCCEEEEEHHHHCCCCHHHHHHHCCCCCCCCCCCCCCCCCCC
VNKAVFKEAVVMQMTLPGAPTVYYGDEAGVCGFTDPDNRRTYPWGHEDTELIDFHRTAIK
CHHHHHHHHHEEEEECCCCCEEEECCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHH
MHKENDVLRKGSYKSLYSAYNVVAYGRFTSDDAAIIIVNNNDDEVRARIPAWEVGLGFDD
HHCCCCHHHCCCHHHHHHHHCEEEEEEECCCCCEEEEEECCCCCEEEECCEEEECCCCCC
DVEQLLVTFEGGYSTDRLGYHLQNGWLDIGLRKTSAVVLHKMKW
CHHHEEEEECCCCCCCCCCEEECCCEEEEEECHHHEEEEEECCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 7548164; 12051850 [H]