| Definition | Chloroflexus sp. Y-400-fl chromosome, complete genome. |
|---|---|
| Accession | NC_012032 |
| Length | 5,268,950 |
Click here to switch to the map view.
The map label for this gene is apu [H]
Identifier: 222524046
GI number: 222524046
Start: 949955
End: 954106
Strand: Direct
Name: apu [H]
Synonym: Chy400_0761
Alternate gene names: 222524046
Gene position: 949955-954106 (Clockwise)
Preceding gene: 222524045
Following gene: 222524047
Centisome position: 18.03
GC content: 57.42
Gene sequence:
>4152_bases GTGAGACCGCGCATGTTTCTCCGCCTGATGCACCTCATCCTTGCGATTGGGGTGCTCTTTGGTGCAACGATTGCACCACT CTCCTCGGTTGCGTTCGCCGATCACACGCCATTACCAGCGTCAGTTAACCTGGCAGGTGATTTACAGTCGGAAGCGACCG GCGGCGCCTGTGGCGATTGGGATCCGGGATGTGCCGCAGCGGCCTTCAGCGCTCAGGGTAACGGTGTCTATCTGTTCGTC TCGCAGACGATTCCAGCAGGGAGCTACGAATACAAGATCGCAATGGGGAGCTGGGCTGAAAACTATGGGGCTAATTTTCA GCAGAATGGCCCCAACATCCCGGTGACGCTCGGCAGTGCACAGAGTGTACGGTTCTACTACGATCACAAAACCCATTATA TCGCCGACAGCGTGCGTAACACTATCTACACCGTACCGGGTAACTTCAACGACGAGATCGGGTGCAGTGGTGACTGGCAA CCAGATTGTCTGCGCACGTTCATGAGTGATGTTGATGGTGATGGTGTCTTTACATTTGCCACTGACGCCATTCCACCCGG CAATTATGAGTTCAAGATTGCCACAAATGAGAGCTGGGCAAACCCAAATTATGGCGCATTTGGGAACAATGTTCCCTTTA CAGTTACCGGCCCGGCAACCGTCATTTTTAGCTTCAATACGGCAACTACGTATGTTGGTGTGGAAGTACGTAGTGCACTC CCGCAGCCTGACAACAATGTGGAGTGGGACGGCGTTTACCACAACTCGCGCGATCCTCTTTATCGCACGCCGGGAGGTGC TGTACCTGCCGGTACACCGGTGACAATTCGGCTCCGCACCTTCCACAATGATGTCACGGCGGTAACCCTGCGGGTGTACG ATGTCAATGCCGGGGCACAGCGGTTCATTCCGATGAGTGTCGTCGCTGCCAATACCGACTGTTACGGCGATTATGGGCCA CGTCGGTGCGATTTCTGGGCGGCTACGCTGAATGAGGCGCAACCGAACAACCTCTGGTACCGCTTTATTGTCACCGATGG CAGTGATACCGACTATTACGCCGATAACACCGCAGCGCTCGATGGCGGCAGCGGACGTATGACGGATGATGTCGTTGACT TCAGTTATGCCTTGATGTTCTACGATCCGGCATTCACCTCGCCAAACTGGGCACGAACGGCAGTCATCTACCAGATTTTC CCTGATCGTTTTCGCAATGGCGATCCGCATAACGATCCGCAAGACGGTGACATCCGGTACGATGATCCGGTGATTACGTT GGGTTGGGGTGAATTACCTGAAGGCTATTGCCGTCACTATGCCGACGCAACCACCAATTGTCCGTGGCGGTTTGACACGA CCCCACCGGCCTGGAGTCCAACTATCGAAGGGCCACGGGGACGTGATTACTACGGCGGTGATTTGGCCGGCGTGATCGAG CAACTTGACTACCTCCAGCAATTGGGCATCACGACCATCTACTTCAATCCCATCTTTGCCGCCGGATCGAACCATCGCTA CGATACCCGTGATTACTATCGCATCGATCCCTATCTTGGCAATAACGGCACCTTTGCGCACCTGGTTCAGGAGGCGCGGC GGCGTGGGATGCGAGTGATCCTCGATAGCGTCTTCAATCACATGTCGTCGGATAGCCCCTTCTTCGACCGCTATAGCCAT TACACGACCCTGGGTGCCTGCGAGTCACTGGCCTCGCCATATCGCACCTGGTTCAACTTCCGCACGAATAATGTTCCGTG TACGAGCGACGATTATGTCGGCTGGTTTGGCTTCGACTCCATCCCCGAAATCAACAAATCAAACCCGGATGTGCAGAGCT ACTTCTTAACCGGAGCCAACAGTGTGACACGCTTCTGGCTACGACGCGGTGCCGCCGGTTGGCGCCTGGATGTGATGGGA GATGCCAGCTTCCCGGCAGGCTATTGGGAGACATTCCGCACCGTCGTGCGCCAGACCAAACGAGACGGTCTGATTATTGG TGAGTTGTGGCAGAAGGACTCAACATTGCTGCGCCACCTCCGTGGGCAGACTGCCGATACAACGATGAACTACCGTCTGC GTGATGCGGTGATCGGCTTGCTCCTGCCTGGGGGAACGTTTGACAGCAAAGGGTTTGGTGACAGTGGCCGGGTCATCAGT CCATCAGAATTCTTGAGTCGACTGGCCTCGATCCGTGAAGACTACCCGGATGCAGCCTACTACACGCTCATGAATCTGCT CGGCAGCCACGATACGGAGCGGATTCTGTGGACGCTTACGCCTGGACAGGAGACACGCGCCGATAAGGAATTCAATGCCG CTAATCTGGCAGAAGGTAAGCGGCGTGTCCAACTGGCCTCTCTGATCCAATTCACCGTACCCGGTGCACCGACCGTGTAT TACGGCGATGAAGTAGGAGTCACCGGCGATGATGATCCAGATGACCGCCGCACCTATCCCTGGCCTGATCAGGGTGGTAC ACCCGACACCAACCTTCTGAACCATTACCGCAGCCTGACCGAGCTGCGCAACCGTTATCCGGTGCTGGCGAAGGGTGATT TCACACCGCTGCTGGCCGACGATGCCGCAGGCGTTGTGGCCTATGGTCGAAAGTATCGCAATAAAGCCGCGTTGGTGCTG ATCAATCGCAGCTCAACAACGCAGACGATCACGGTACCCGTACAGGGCTTTCTGCCCAATGGGGTAGAACTCTGCGCGCT GTTTACCGTTGGCAATCAGCTCGACGAGACGGTACAGGTCGTGAACGGGAGCATCCAGATCACGCTGAACCCGCTGAGCG GTACGGTGCTGATCAGCGAGCCGGGAGCCGATCTCACGCCACCGGCGGCCCCCACCAACCTCCAGGTCACCGAAGAGGGT GATCGGTCGGTAAGCCTGAGCTGGCAGCGGCCCAGTGGTGGAGCACAGGCGTACAACATCTACCGCAGCCCGGTTAGTGG CGGTGGTTGGGTCAAGGTCAATACTGCGCCGGTAAGCGGTCTGAGCTTTACCGACACCACGGTAGAGAACGGGCGAACCT ACTACTTCGTTGTCCGTGCGCTTGACGCCGTCGGGAACGAAGGGCCAGCTTCGGCGGAAGTGAGCGCTCTGCCGCACTAC CGGATTGGGTGGGCCAATTTGCAATGGCCACCGGCGATCTCACACACCGTGTCGGCCATCAACACCACCCCGGATATTTA CGGGCAGGTCTGGATCGACGGTGTAACCAGTCAGCCCGGCGCGACACCTGGCCTGCGTGCTCAGGTGGGATACGGCCCGC AGGGCAGTGATCCCCGTGGGAGCAACTGGGTGTGGGTGGAGGCTACCTTCAACGTTGATGCCGGCAACAACGACGAATTC AAGGCGCAACTCCAGCCCGAAACGGTTGGCACCTTCGATTACGTCTTCCGCTACAGCACCACCAACGGACGCGACTGGCT CTACGCCGACAGCAGTGGGCCGTTCAGTGGCTTACCGCCACAACCAGGCGTACTCACCGTTCTTTCCAGTGGTGACACAA CACCGCCGGCAGTCCCAACCGGCCTGCAAGTGATCAGCGCGTCCCCGGCAGGAATCGTCTTGAGCTGGAATGCCGTCGGT GATGCCTATGCCTACGAAGTACGCCGTATCGATGGCAACGGCAATGAACTCATCTTTGCCCGTACAACTGCAACCACCTT CACCGACACCGGTGTCATGCAGGGGGCAACGTACACCTATGACGTGCGTTCTTTAGACATCTCCTTCAACCGTTCAGCCT TCAGCGCACCGGTAACGGCTACCGCCGAACTCCGCACGGTTACGCTGGTGATGAATGTGACGGTACCGACCCCGGTTGAA GACGCGATTGGGCGCAGCGTCTACATTGCCGGCTTCCTTGACCGGCTCGACGGTGGTTTACCGCAGTGGAATCCGGGTGG TGTGGTGATGACGCAGGTCTCGGCAACACAGTGGACAATCACCTTCACCGGACGCGAGGGCACGCAACTCGAATACAAGT ACACCCTCGGATCGTGGGACTACGTTGAGAAGGGTGCGACTTGTGAAGAGCTGGCCAACCGGCAATTGACGCTGACCTAC GGTACGAGTGGCGTGCAGACGGTCAATGACACTGTGCTCAACTGGCGAAATGTAGACCCGTGTGGGAATTAG
Upstream 100 bases:
>100_bases TAGCGCCCAACGTGCGGCCAGTGCAATGACGCCGCTTCACGGCATCCCCGACCGGATGCCGCTGTGTTGAGAGAGCACTA TTCGTGCAAAGGAGCTTTGT
Downstream 100 bases:
>100_bases GACAGGAGGGGTAGCAGGCTTACCCGCCTCGTTACCCTGATGAGAGCAACCGGAACCTCACGCACATGCGGCAACCAGTT TTGGTTGCCGCATTGCCATT
Product: alpha amylase catalytic subunit
Products: NA
Alternate protein names: Alpha-amylase/pullulanase; Alpha-amylase; 1,4-alpha-D-glucan glucanohydrolase; Pullulanase; 1,4-alpha-D-glucan glucanohydrolase; Alpha-dextrin endo-1,6-alpha-glucosidase [H]
Number of amino acids: Translated: 1383; Mature: 1383
Protein sequence:
>1383_residues MRPRMFLRLMHLILAIGVLFGATIAPLSSVAFADHTPLPASVNLAGDLQSEATGGACGDWDPGCAAAAFSAQGNGVYLFV SQTIPAGSYEYKIAMGSWAENYGANFQQNGPNIPVTLGSAQSVRFYYDHKTHYIADSVRNTIYTVPGNFNDEIGCSGDWQ PDCLRTFMSDVDGDGVFTFATDAIPPGNYEFKIATNESWANPNYGAFGNNVPFTVTGPATVIFSFNTATTYVGVEVRSAL PQPDNNVEWDGVYHNSRDPLYRTPGGAVPAGTPVTIRLRTFHNDVTAVTLRVYDVNAGAQRFIPMSVVAANTDCYGDYGP RRCDFWAATLNEAQPNNLWYRFIVTDGSDTDYYADNTAALDGGSGRMTDDVVDFSYALMFYDPAFTSPNWARTAVIYQIF PDRFRNGDPHNDPQDGDIRYDDPVITLGWGELPEGYCRHYADATTNCPWRFDTTPPAWSPTIEGPRGRDYYGGDLAGVIE QLDYLQQLGITTIYFNPIFAAGSNHRYDTRDYYRIDPYLGNNGTFAHLVQEARRRGMRVILDSVFNHMSSDSPFFDRYSH YTTLGACESLASPYRTWFNFRTNNVPCTSDDYVGWFGFDSIPEINKSNPDVQSYFLTGANSVTRFWLRRGAAGWRLDVMG DASFPAGYWETFRTVVRQTKRDGLIIGELWQKDSTLLRHLRGQTADTTMNYRLRDAVIGLLLPGGTFDSKGFGDSGRVIS PSEFLSRLASIREDYPDAAYYTLMNLLGSHDTERILWTLTPGQETRADKEFNAANLAEGKRRVQLASLIQFTVPGAPTVY YGDEVGVTGDDDPDDRRTYPWPDQGGTPDTNLLNHYRSLTELRNRYPVLAKGDFTPLLADDAAGVVAYGRKYRNKAALVL INRSSTTQTITVPVQGFLPNGVELCALFTVGNQLDETVQVVNGSIQITLNPLSGTVLISEPGADLTPPAAPTNLQVTEEG DRSVSLSWQRPSGGAQAYNIYRSPVSGGGWVKVNTAPVSGLSFTDTTVENGRTYYFVVRALDAVGNEGPASAEVSALPHY RIGWANLQWPPAISHTVSAINTTPDIYGQVWIDGVTSQPGATPGLRAQVGYGPQGSDPRGSNWVWVEATFNVDAGNNDEF KAQLQPETVGTFDYVFRYSTTNGRDWLYADSSGPFSGLPPQPGVLTVLSSGDTTPPAVPTGLQVISASPAGIVLSWNAVG DAYAYEVRRIDGNGNELIFARTTATTFTDTGVMQGATYTYDVRSLDISFNRSAFSAPVTATAELRTVTLVMNVTVPTPVE DAIGRSVYIAGFLDRLDGGLPQWNPGGVVMTQVSATQWTITFTGREGTQLEYKYTLGSWDYVEKGATCEELANRQLTLTY GTSGVQTVNDTVLNWRNVDPCGN
Sequences:
>Translated_1383_residues MRPRMFLRLMHLILAIGVLFGATIAPLSSVAFADHTPLPASVNLAGDLQSEATGGACGDWDPGCAAAAFSAQGNGVYLFV SQTIPAGSYEYKIAMGSWAENYGANFQQNGPNIPVTLGSAQSVRFYYDHKTHYIADSVRNTIYTVPGNFNDEIGCSGDWQ PDCLRTFMSDVDGDGVFTFATDAIPPGNYEFKIATNESWANPNYGAFGNNVPFTVTGPATVIFSFNTATTYVGVEVRSAL PQPDNNVEWDGVYHNSRDPLYRTPGGAVPAGTPVTIRLRTFHNDVTAVTLRVYDVNAGAQRFIPMSVVAANTDCYGDYGP RRCDFWAATLNEAQPNNLWYRFIVTDGSDTDYYADNTAALDGGSGRMTDDVVDFSYALMFYDPAFTSPNWARTAVIYQIF PDRFRNGDPHNDPQDGDIRYDDPVITLGWGELPEGYCRHYADATTNCPWRFDTTPPAWSPTIEGPRGRDYYGGDLAGVIE QLDYLQQLGITTIYFNPIFAAGSNHRYDTRDYYRIDPYLGNNGTFAHLVQEARRRGMRVILDSVFNHMSSDSPFFDRYSH YTTLGACESLASPYRTWFNFRTNNVPCTSDDYVGWFGFDSIPEINKSNPDVQSYFLTGANSVTRFWLRRGAAGWRLDVMG DASFPAGYWETFRTVVRQTKRDGLIIGELWQKDSTLLRHLRGQTADTTMNYRLRDAVIGLLLPGGTFDSKGFGDSGRVIS PSEFLSRLASIREDYPDAAYYTLMNLLGSHDTERILWTLTPGQETRADKEFNAANLAEGKRRVQLASLIQFTVPGAPTVY YGDEVGVTGDDDPDDRRTYPWPDQGGTPDTNLLNHYRSLTELRNRYPVLAKGDFTPLLADDAAGVVAYGRKYRNKAALVL INRSSTTQTITVPVQGFLPNGVELCALFTVGNQLDETVQVVNGSIQITLNPLSGTVLISEPGADLTPPAAPTNLQVTEEG DRSVSLSWQRPSGGAQAYNIYRSPVSGGGWVKVNTAPVSGLSFTDTTVENGRTYYFVVRALDAVGNEGPASAEVSALPHY RIGWANLQWPPAISHTVSAINTTPDIYGQVWIDGVTSQPGATPGLRAQVGYGPQGSDPRGSNWVWVEATFNVDAGNNDEF KAQLQPETVGTFDYVFRYSTTNGRDWLYADSSGPFSGLPPQPGVLTVLSSGDTTPPAVPTGLQVISASPAGIVLSWNAVG DAYAYEVRRIDGNGNELIFARTTATTFTDTGVMQGATYTYDVRSLDISFNRSAFSAPVTATAELRTVTLVMNVTVPTPVE DAIGRSVYIAGFLDRLDGGLPQWNPGGVVMTQVSATQWTITFTGREGTQLEYKYTLGSWDYVEKGATCEELANRQLTLTY GTSGVQTVNDTVLNWRNVDPCGN >Mature_1383_residues MRPRMFLRLMHLILAIGVLFGATIAPLSSVAFADHTPLPASVNLAGDLQSEATGGACGDWDPGCAAAAFSAQGNGVYLFV SQTIPAGSYEYKIAMGSWAENYGANFQQNGPNIPVTLGSAQSVRFYYDHKTHYIADSVRNTIYTVPGNFNDEIGCSGDWQ PDCLRTFMSDVDGDGVFTFATDAIPPGNYEFKIATNESWANPNYGAFGNNVPFTVTGPATVIFSFNTATTYVGVEVRSAL PQPDNNVEWDGVYHNSRDPLYRTPGGAVPAGTPVTIRLRTFHNDVTAVTLRVYDVNAGAQRFIPMSVVAANTDCYGDYGP RRCDFWAATLNEAQPNNLWYRFIVTDGSDTDYYADNTAALDGGSGRMTDDVVDFSYALMFYDPAFTSPNWARTAVIYQIF PDRFRNGDPHNDPQDGDIRYDDPVITLGWGELPEGYCRHYADATTNCPWRFDTTPPAWSPTIEGPRGRDYYGGDLAGVIE QLDYLQQLGITTIYFNPIFAAGSNHRYDTRDYYRIDPYLGNNGTFAHLVQEARRRGMRVILDSVFNHMSSDSPFFDRYSH YTTLGACESLASPYRTWFNFRTNNVPCTSDDYVGWFGFDSIPEINKSNPDVQSYFLTGANSVTRFWLRRGAAGWRLDVMG DASFPAGYWETFRTVVRQTKRDGLIIGELWQKDSTLLRHLRGQTADTTMNYRLRDAVIGLLLPGGTFDSKGFGDSGRVIS PSEFLSRLASIREDYPDAAYYTLMNLLGSHDTERILWTLTPGQETRADKEFNAANLAEGKRRVQLASLIQFTVPGAPTVY YGDEVGVTGDDDPDDRRTYPWPDQGGTPDTNLLNHYRSLTELRNRYPVLAKGDFTPLLADDAAGVVAYGRKYRNKAALVL INRSSTTQTITVPVQGFLPNGVELCALFTVGNQLDETVQVVNGSIQITLNPLSGTVLISEPGADLTPPAAPTNLQVTEEG DRSVSLSWQRPSGGAQAYNIYRSPVSGGGWVKVNTAPVSGLSFTDTTVENGRTYYFVVRALDAVGNEGPASAEVSALPHY RIGWANLQWPPAISHTVSAINTTPDIYGQVWIDGVTSQPGATPGLRAQVGYGPQGSDPRGSNWVWVEATFNVDAGNNDEF KAQLQPETVGTFDYVFRYSTTNGRDWLYADSSGPFSGLPPQPGVLTVLSSGDTTPPAVPTGLQVISASPAGIVLSWNAVG DAYAYEVRRIDGNGNELIFARTTATTFTDTGVMQGATYTYDVRSLDISFNRSAFSAPVTATAELRTVTLVMNVTVPTPVE DAIGRSVYIAGFLDRLDGGLPQWNPGGVVMTQVSATQWTITFTGREGTQLEYKYTLGSWDYVEKGATCEELANRQLTLTY GTSGVQTVNDTVLNWRNVDPCGN
Specific function: May Play A Role In Regulating The Intracellular Level Of Maltotriose. Cleaves Glucose From The Reducing End Of Maltotriose And Longer Maltodextrins With A Chain Length Of Up To 7 Glucose Units. [C]
COG id: COG0366
COG function: function code G; Glycosidases
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 2 fibronectin type-III domains [H]
Homologues:
Organism=Homo sapiens, GI187423904, Length=369, Percent_Identity=22.4932249322493, Blast_Score=78, Evalue=6e-14, Organism=Escherichia coli, GI1786604, Length=530, Percent_Identity=30.188679245283, Blast_Score=218, Evalue=3e-57, Organism=Escherichia coli, GI1790687, Length=362, Percent_Identity=26.2430939226519, Blast_Score=92, Evalue=3e-19, Organism=Saccharomyces cerevisiae, GI6322245, Length=191, Percent_Identity=27.2251308900524, Blast_Score=76, Evalue=4e-14, Organism=Saccharomyces cerevisiae, GI6321726, Length=191, Percent_Identity=25.6544502617801, Blast_Score=69, Evalue=7e-12, Organism=Saccharomyces cerevisiae, GI6324416, Length=191, Percent_Identity=25.6544502617801, Blast_Score=68, Evalue=9e-12, Organism=Saccharomyces cerevisiae, GI6322241, Length=191, Percent_Identity=25.6544502617801, Blast_Score=68, Evalue=9e-12, Organism=Saccharomyces cerevisiae, GI6322021, Length=191, Percent_Identity=25.6544502617801, Blast_Score=68, Evalue=9e-12, Organism=Saccharomyces cerevisiae, GI6321731, Length=193, Percent_Identity=25.3886010362694, Blast_Score=65, Evalue=8e-11, Organism=Saccharomyces cerevisiae, GI6319776, Length=193, Percent_Identity=25.3886010362694, Blast_Score=65, Evalue=9e-11, Organism=Drosophila melanogaster, GI221330053, Length=388, Percent_Identity=23.4536082474227, Blast_Score=91, Evalue=7e-18, Organism=Drosophila melanogaster, GI24586587, Length=393, Percent_Identity=24.9363867684478, Blast_Score=86, Evalue=3e-16, Organism=Drosophila melanogaster, GI24583745, Length=551, Percent_Identity=22.1415607985481, Blast_Score=80, Evalue=8e-15, Organism=Drosophila melanogaster, GI24586589, Length=181, Percent_Identity=28.7292817679558, Blast_Score=80, Evalue=9e-15, Organism=Drosophila melanogaster, GI24586593, Length=188, Percent_Identity=29.2553191489362, Blast_Score=78, Evalue=3e-14, Organism=Drosophila melanogaster, GI24586599, Length=184, Percent_Identity=27.1739130434783, Blast_Score=73, Evalue=2e-12,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR006048 - InterPro: IPR013784 - InterPro: IPR008957 - InterPro: IPR003961 - InterPro: IPR013780 - InterPro: IPR006047 - InterPro: IPR004185 - InterPro: IPR006589 - InterPro: IPR002044 - InterPro: IPR017853 - InterPro: IPR013781 - InterPro: IPR013783 - InterPro: IPR014756 [H]
Pfam domain/function: PF00128 Alpha-amylase; PF02903 Alpha-amylase_N; PF00041 fn3 [H]
EC number: =3.2.1.1; =3.2.1.41 [H]
Molecular weight: Translated: 151509; Mature: 151509
Theoretical pI: Translated: 4.54; Mature: 4.54
Prosite motif: PS50853 FN3 ; PS51166 CBM20
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.9 %Cys (Translated Protein) 1.2 %Met (Translated Protein) 2.1 %Cys+Met (Translated Protein) 0.9 %Cys (Mature Protein) 1.2 %Met (Mature Protein) 2.1 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MRPRMFLRLMHLILAIGVLFGATIAPLSSVAFADHTPLPASVNLAGDLQSEATGGACGDW CCHHHHHHHHHHHHHHHHHHCCHHHHHHHHHCCCCCCCCCEEEECCCCCCCCCCCCCCCC DPGCAAAAFSAQGNGVYLFVSQTIPAGSYEYKIAMGSWAENYGANFQQNGPNIPVTLGSA CCCCCEEEEECCCCEEEEEEECCCCCCCEEEEEEECCCHHHHCCCCCCCCCCCCEEECCC QSVRFYYDHKTHYIADSVRNTIYTVPGNFNDEIGCSGDWQPDCLRTFMSDVDGDGVFTFA CEEEEEEECCCCHHHHHHCCEEEECCCCCCCCCCCCCCCCHHHHHHHHHHCCCCEEEEEE TDAIPPGNYEFKIATNESWANPNYGAFGNNVPFTVTGPATVIFSFNTATTYVGVEVRSAL ECCCCCCCEEEEEECCCCCCCCCCCCCCCCCCEEEECCEEEEEEECCCEEEEEEEHHHHC PQPDNNVEWDGVYHNSRDPLYRTPGGAVPAGTPVTIRLRTFHNDVTAVTLRVYDVNAGAQ CCCCCCCEECEEEECCCCCCEECCCCCCCCCCCEEEEEEEECCCEEEEEEEEEEECCCCC RFIPMSVVAANTDCYGDYGPRRCDFWAATLNEAQPNNLWYRFIVTDGSDTDYYADNTAAL CCCEEEEEEECCCCCCCCCCCEEEEEEEECCCCCCCCEEEEEEEECCCCCCEECCCCEEE DGGSGRMTDDVVDFSYALMFYDPAFTSPNWARTAVIYQIFPDRFRNGDPHNDPQDGDIRY ECCCCCCCHHHHHHEEEEEEECCCCCCCCCHHEEEEEEECHHHHCCCCCCCCCCCCCEEE DDPVITLGWGELPEGYCRHYADATTNCPWRFDTTPPAWSPTIEGPRGRDYYGGDLAGVIE CCCEEEECCCCCCHHHHHHHCCCCCCCCEEECCCCCCCCCCCCCCCCCCCCCCHHHHHHH QLDYLQQLGITTIYFNPIFAAGSNHRYDTRDYYRIDPYLGNNGTFAHLVQEARRRGMRVI HHHHHHHCCCEEEEECCEEECCCCCCCCCCCEEEECCEECCCCHHHHHHHHHHHCCHHHH LDSVFNHMSSDSPFFDRYSHYTTLGACESLASPYRTWFNFRTNNVPCTSDDYVGWFGFDS HHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHEEECCCCCCCCCCCEEEECCCC IPEINKSNPDVQSYFLTGANSVTRFWLRRGAAGWRLDVMGDASFPAGYWETFRTVVRQTK CCCCCCCCCCCEEEEEECCCHHHHHHHHCCCCCCEEEEECCCCCCCHHHHHHHHHHHHHH RDGLIIGELWQKDSTLLRHLRGQTADTTMNYRLRDAVIGLLLPGGTFDSKGFGDSGRVIS CCCEEEEHHHCCHHHHHHHHCCCCCCCEEEEEEHHEEEEEEECCCCCCCCCCCCCCCEEC PSEFLSRLASIREDYPDAAYYTLMNLLGSHDTERILWTLTPGQETRADKEFNAANLAEGK HHHHHHHHHHHHHCCCCHHHHHHHHHHCCCCCCEEEEEECCCCCCCCCCCCCCHHHHHHH RRVQLASLIQFTVPGAPTVYYGDEVGVTGDDDPDDRRTYPWPDQGGTPDTNLLNHYRSLT HHHHHHHHHEEECCCCCEEEECCEECCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHH ELRNRYPVLAKGDFTPLLADDAAGVVAYGRKYRNKAALVLINRSSTTQTITVPVQGFLPN HHHHCCCEEECCCCCEEECCCCCCHHHHHHHHCCCEEEEEEECCCCCEEEEEEEECCCCC GVELCALFTVGNQLDETVQVVNGSIQITLNPLSGTVLISEPGADLTPPAAPTNLQVTEEG CCEEEEEEECCCHHHHHHHHHCCEEEEEEECCCCEEEEECCCCCCCCCCCCCCEEEEECC DRSVSLSWQRPSGGAQAYNIYRSPVSGGGWVKVNTAPVSGLSFTDTTVENGRTYYFVVRA CCEEEEEEECCCCCCEEEEEEECCCCCCCEEEEECCCCCCCEEECCHHCCCCEEEEEEEE LDAVGNEGPASAEVSALPHYRIGWANLQWPPAISHTVSAINTTPDIYGQVWIDGVTSQPG HHHHCCCCCCCCEEECCCCEEEEECCCCCCCCHHHHHHHHCCCCCCCEEEEEECCCCCCC ATPGLRAQVGYGPQGSDPRGSNWVWVEATFNVDAGNNDEFKAQLQPETVGTFDYVFRYST CCCCCEEEECCCCCCCCCCCCCEEEEEEEEEECCCCCCCEEEEECCCCCCCEEEEEEEEC TNGRDWLYADSSGPFSGLPPQPGVLTVLSSGDTTPPAVPTGLQVISASPAGIVLSWNAVG CCCCEEEEECCCCCCCCCCCCCCEEEEEECCCCCCCCCCCCCEEEECCCCCEEEEECCCC DAYAYEVRRIDGNGNELIFARTTATTFTDTGVMQGATYTYDVRSLDISFNRSAFSAPVTA CEEEEEEEEECCCCCEEEEEEECCCEEECCCCCCCCEEEEEEEEEEEEECCCCCCCCCEE TAELRTVTLVMNVTVPTPVEDAIGRSVYIAGFLDRLDGGLPQWNPGGVVMTQVSATQWTI EEEEEEEEEEEEEECCCCHHHHCCCEEEEEEHHHHHCCCCCCCCCCCEEEEEEECEEEEE TFTGREGTQLEYKYTLGSWDYVEKGATCEELANRQLTLTYGTSGVQTVNDTVLNWRNVDP EEECCCCCEEEEEEECCCCHHHHCCCCHHHHCCCEEEEEECCCCCEECCHHHEECCCCCC CGN CCC >Mature Secondary Structure MRPRMFLRLMHLILAIGVLFGATIAPLSSVAFADHTPLPASVNLAGDLQSEATGGACGDW CCHHHHHHHHHHHHHHHHHHCCHHHHHHHHHCCCCCCCCCEEEECCCCCCCCCCCCCCCC DPGCAAAAFSAQGNGVYLFVSQTIPAGSYEYKIAMGSWAENYGANFQQNGPNIPVTLGSA CCCCCEEEEECCCCEEEEEEECCCCCCCEEEEEEECCCHHHHCCCCCCCCCCCCEEECCC QSVRFYYDHKTHYIADSVRNTIYTVPGNFNDEIGCSGDWQPDCLRTFMSDVDGDGVFTFA CEEEEEEECCCCHHHHHHCCEEEECCCCCCCCCCCCCCCCHHHHHHHHHHCCCCEEEEEE TDAIPPGNYEFKIATNESWANPNYGAFGNNVPFTVTGPATVIFSFNTATTYVGVEVRSAL ECCCCCCCEEEEEECCCCCCCCCCCCCCCCCCEEEECCEEEEEEECCCEEEEEEEHHHHC PQPDNNVEWDGVYHNSRDPLYRTPGGAVPAGTPVTIRLRTFHNDVTAVTLRVYDVNAGAQ CCCCCCCEECEEEECCCCCCEECCCCCCCCCCCEEEEEEEECCCEEEEEEEEEEECCCCC RFIPMSVVAANTDCYGDYGPRRCDFWAATLNEAQPNNLWYRFIVTDGSDTDYYADNTAAL CCCEEEEEEECCCCCCCCCCCEEEEEEEECCCCCCCCEEEEEEEECCCCCCEECCCCEEE DGGSGRMTDDVVDFSYALMFYDPAFTSPNWARTAVIYQIFPDRFRNGDPHNDPQDGDIRY ECCCCCCCHHHHHHEEEEEEECCCCCCCCCHHEEEEEEECHHHHCCCCCCCCCCCCCEEE DDPVITLGWGELPEGYCRHYADATTNCPWRFDTTPPAWSPTIEGPRGRDYYGGDLAGVIE CCCEEEECCCCCCHHHHHHHCCCCCCCCEEECCCCCCCCCCCCCCCCCCCCCCHHHHHHH QLDYLQQLGITTIYFNPIFAAGSNHRYDTRDYYRIDPYLGNNGTFAHLVQEARRRGMRVI HHHHHHHCCCEEEEECCEEECCCCCCCCCCCEEEECCEECCCCHHHHHHHHHHHCCHHHH LDSVFNHMSSDSPFFDRYSHYTTLGACESLASPYRTWFNFRTNNVPCTSDDYVGWFGFDS HHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHEEECCCCCCCCCCCEEEECCCC IPEINKSNPDVQSYFLTGANSVTRFWLRRGAAGWRLDVMGDASFPAGYWETFRTVVRQTK CCCCCCCCCCCEEEEEECCCHHHHHHHHCCCCCCEEEEECCCCCCCHHHHHHHHHHHHHH RDGLIIGELWQKDSTLLRHLRGQTADTTMNYRLRDAVIGLLLPGGTFDSKGFGDSGRVIS CCCEEEEHHHCCHHHHHHHHCCCCCCCEEEEEEHHEEEEEEECCCCCCCCCCCCCCCEEC PSEFLSRLASIREDYPDAAYYTLMNLLGSHDTERILWTLTPGQETRADKEFNAANLAEGK HHHHHHHHHHHHHCCCCHHHHHHHHHHCCCCCCEEEEEECCCCCCCCCCCCCCHHHHHHH RRVQLASLIQFTVPGAPTVYYGDEVGVTGDDDPDDRRTYPWPDQGGTPDTNLLNHYRSLT HHHHHHHHHEEECCCCCEEEECCEECCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHH ELRNRYPVLAKGDFTPLLADDAAGVVAYGRKYRNKAALVLINRSSTTQTITVPVQGFLPN HHHHCCCEEECCCCCEEECCCCCCHHHHHHHHCCCEEEEEEECCCCCEEEEEEEECCCCC GVELCALFTVGNQLDETVQVVNGSIQITLNPLSGTVLISEPGADLTPPAAPTNLQVTEEG CCEEEEEEECCCHHHHHHHHHCCEEEEEEECCCCEEEEECCCCCCCCCCCCCCEEEEECC DRSVSLSWQRPSGGAQAYNIYRSPVSGGGWVKVNTAPVSGLSFTDTTVENGRTYYFVVRA CCEEEEEEECCCCCCEEEEEEECCCCCCCEEEEECCCCCCCEEECCHHCCCCEEEEEEEE LDAVGNEGPASAEVSALPHYRIGWANLQWPPAISHTVSAINTTPDIYGQVWIDGVTSQPG HHHHCCCCCCCCEEECCCCEEEEECCCCCCCCHHHHHHHHCCCCCCCEEEEEECCCCCCC ATPGLRAQVGYGPQGSDPRGSNWVWVEATFNVDAGNNDEFKAQLQPETVGTFDYVFRYST CCCCCEEEECCCCCCCCCCCCCEEEEEEEEEECCCCCCCEEEEECCCCCCCEEEEEEEEC TNGRDWLYADSSGPFSGLPPQPGVLTVLSSGDTTPPAVPTGLQVISASPAGIVLSWNAVG CCCCEEEEECCCCCCCCCCCCCCEEEEEECCCCCCCCCCCCCEEEECCCCCEEEEECCCC DAYAYEVRRIDGNGNELIFARTTATTFTDTGVMQGATYTYDVRSLDISFNRSAFSAPVTA CEEEEEEEEECCCCCEEEEEEECCCEEECCCCCCCCEEEEEEEEEEEEECCCCCCCCCEE TAELRTVTLVMNVTVPTPVEDAIGRSVYIAGFLDRLDGGLPQWNPGGVVMTQVSATQWTI EEEEEEEEEEEEEECCCCHHHHCCCEEEEEEHHHHHCCCCCCCCCCCEEEEEEECEEEEE TFTGREGTQLEYKYTLGSWDYVEKGATCEELANRQLTLTYGTSGVQTVNDTVLNWRNVDP EEECCCCCEEEEEEECCCCHHHHCCCCHHHHCCCEEEEEECCCCCEECCHHHEECCCCCC CGN CCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 2302196 [H]