Definition Shigella boydii Sb227, complete genome.
Accession NC_007613
Length 4,519,823

Click here to switch to the map view.

The map label for this gene is sigA [H]

Identifier: 82542830

GI number: 82542830

Start: 247479

End: 251336

Strand: Direct

Name: sigA [H]

Synonym: SBO_0233

Alternate gene names: 82542830

Gene position: 247479-251336 (Clockwise)

Preceding gene: 161984984

Following gene: 82542832

Centisome position: 5.48

GC content: 41.68

Gene sequence:

>3858_bases
ATGAATAAAATTTATTCACTGAAATATAGTCATATTACAGGTGGATTAGTTGCTGTTTCTGAACTGACCCGGAAAGTTAG
TGTCGGTACATCAAGAAAGAAAGTTATCCTCGGTATTATTTTATCCTCAATATATGGAAGTTATGGTGAAACAGCATTTG
CAGCAATGCTGGATATAAATAATATATGGACCCGCGATTATCTTGACCTTGCTCAAAACAGAGGAGAGTTCAGACCGGGT
GCAACAAATGTTCAATTAATGATGAAAGATGGAAAGATATTTCATTTTCCAGAACTACCTGTACCTGATTTTTCTGCTGT
TTCCAACAAAGGTGCAACAACATCAATTGGAGGTGCGTACAGTGTTACTGCGACTCATAACGGTACACAGCATCATGCAA
TAACAACACAGTCATGGGATCAGACAGCATATAAAGCAAGTAACAGAGTATCATCTGGCGACTTTTCGGTTCATCGTCTG
AATAAATTCGTCGTGGAAACAACAGGGGTTACGGAGAGTGCCGACTTCTCACTTTCTCCCGAAGATGCGATGAAAAGATA
TGGCGTAAACTACAACGGTAAGGAACAAATAATTGGCTTCAGAGCAGGTGCCGGAACAACCTCAACGATATTAAACGGCA
AACAATATCTGTTTGGACAAAACTATAATCCCGACTTGTTAAGCGCAAGTCTTTTTAATCTGGACTGGAAAAACAAGAGT
TACATTTATACCAACAGAACCCCTTTTAAAAACTCACCAATTTTTGGCGATAGTGGTTCTGGTTCTTATCTATATGATAA
AGAACAACAAAAATGGGTTTTCCATGGTGTTACCAGTACAGTTGGTTTTATCAGTAGTACCAATATAGCCTGGACAAACT
ACTCGTTATTTAATAATATTCTGGTAAACAATTTAAAAAAGAATTTCACAAACACTATGCAGCTGGATGGTAAAAAACAA
GAGTTATCATCGATTATAAAAGATAAGGACCTGTCTGTCTCAGGAGGAGGGGAATTAACGCTCAAGCAGGATACCGATCT
TGGCATTGGCGGGCTTATATTCGATAAGAACCAGACATATAAAGTGTACGGAAAAGATAAGTCTTATAAAGGTGCCGGGA
TAGATATTGATAATAATACCACCGTTGAATGGAATGTTAAGGGCGTTGCCGGAGATAATCTGCATAAAATAGGTAGTGGT
ACTCTGGATGTAAAAATAGCACAGGGAAATAACCTTAAAATAGGTAATGGGACTGTCATCCTTAGTGCTGAAAAAGCCTT
CAATAAAATTTACATGGCCGGAGGTAAAGGTACGGTAAAAATAAATGCCAAAGACGCTTTAAGCGAAAGCGGTAATGGCG
AAATCTATTTTACCAGAAATGGCGGAACACTGGATCTAAACGGCTATGACCAGTCATTTCAGAAAATCGCAGCAACAGAT
GCGGGAACAACCGTAACGAACTCAAACGTGAAGCAATCAACATTATCACTTACTAATACTGATGCATATATGTACCATGG
GAATGTATCAGGTAATATAAGCATAAATCATATTATCAATACTACCCAGCAACATAACAATAATGCCAATCTGATCTTTG
ATGGCTCAGTCGATATCAAAAACGATATCTCTGTCCGGAATGCACAGTTAACATTACAAGGACATGCGACAGAACATGCC
ATATTTAAAGAAGGCAATAACAACTGTCCAATTCCTTTTTTATGTCAAAAAGACTATTCTGCTGCCATAAAGGACCAGGA
AAGCACTGTAAATAAACGTTACAATACGGAATATAAGTCCAACAATCAGATAGCCTCTTTTTCCCAGCCCGACTGGGAAA
GTCGTAAATTTAATTTCCGGAAATTAAATTTAGAAAACGCAACCCTGAGTATAGGCCGGGATGCTAATGTAAAAGGACAC
ATAGAGGCTAAAAACTCTCAAATTGTTCTGGGAAATAAAACTGCATACATTGACATGTTCTCAGGAAGAAACATTACTGG
CGAAGGTTTTGGATTCAGACAACAGCTTCGCTCCGGGGATTCAGCAGGCGAAAGTAGTTTCAACGGCAGTCTGAGTGCTC
AAAACAGCAAAATAACTGTTGGTGATAAATCAACTGTTACTATGACTGGTGCATTATCCTTAATTAATACAGACCTGATT
ATCAACAAAGGAGCTACTGTTACCGCCCAGGGAAAAATGTATGTAGATAAAGCTATTGAACTGGCCGGAACCCTGACATT
AACAGGCACCCCTACAGAAAATAATAAATACAGCCCGGCAATCTATATGTCAGATGGATATAATATGACAGAAGATGGTG
CCACGTTAAAGGCTCAAAATTATGCCTGGGTCAATGGTAATATAAAATCAGACAAAAAAGCATCTATTCTGTTTGGTGTT
GACCAGTATAAAGAAGATAACCTGGACAAAACCACACACACACCGCTGGCTACAGGTTTGCTGGGTGGCTTTGATACTTC
TTATACCGGAGGTATTGATGCTCCTGCTGCCTCAGCCAGCATGTATAACACCTTATGGAGAGTAAACGGACAGTCAGCCC
TGCAATCATTAAAAACCCGCGACAGTCTTTTGTTGTTTAGTAACATAGAGAATTCGGGTTTCCATACTGTGACAGTAAAC
ACACTGGATGCCACTAATACTGCTGTGATTATGCGGGCTGATCTGAGCCAGTCTGTAAATCAATCGGATAAACTCATTGT
TAAAAATCAGTTAACCGGAAGCAATAACAGTCTGTCGGTCGATATACAGAAAGTGGGAAATAATAACTCAGGATTAAACG
TTGACCTGATAACAGCCCCAAAAGGAAGCAATAAAGAGATATTTAAAGCCAGTACTCAGGCCATAGGTTTCAGCAACATA
TCTCCTGTGATCAGCACGAAAGAGGATCAGGAACATACCACGTGGACCCTGACCGGATATAAGGTGGCTGAAAATACAGC
ATCTTCCAGTGCAGCAAAATCGTATATGTCCGGTAATTACAAAGCCTTCCTGACAGAAGTCAACAACCTGAATAAACGAA
TGGGGGATCTGCGTGACACCAATGGCGAGGTCGGTGCATGGGCCCGCATCATGAGCGGAGCAGGTTCAGCTTCTGGTGGA
TACAGTGACAACTACACCCATGTGCAGATTGGTGTGGATAAAAAACATGAGCTGGATGGACTTGACCTTTTCACTGGTCT
GACTATGACGTATACCGACAGTCATGCCAGCAGTAATGCATTCAGTGGCAAGACGAAGTCCGTCGGGGCAGGTCTGTATG
CTTCCGCTATATTTGACTCTGGTGCCTATATCGACCTGATTAGTAAGTATGTTCACCATGATAATGAGTACTCGGCGACC
TTTGCTGGGCTCGGAACAAAAGACTACAGTTCTCATTCCTTGTATGTGGGTGCTGAAGCAGGCTACCGCTATCATGTAAC
AGAAGACTCCTGGATTGAGCCGCAGGCAGAACTGGTTTATGGGGCCGTATCAGGTAAACGGTTCGACTGGCAGGATCGCG
GAATGAGCGTGACCATGAAGGATAAGGACTTTAATCCGCTGATTGGGCGTACCGGTGTTGATGTGGGTAAATCCTTCTCC
GGTAAGGACTGGAAAGTCACAGCCCGCGCCGGCCTTGGCTACCAGTTTGACCTGTTTGCCAACGGTGAAACCGTACTGCG
TGATGCGTCCGGTGAGAAACGTATCAAAGGTGAAAAAGACGGTCGTATTCTCATGAATGTTGGTCTCAACGCCGAAATTC
GCGATAATCTTCGCTTTGGTCTTGAGTTTGAGAAATCGGCATTTGGTAAATACAACGTGGATAACGCGATCAACGCCAAC
TTCCGTTACTCTTTCTGA

Upstream 100 bases:

>100_bases
TATCATTATACCCTTATCAGTTACGTACCATGACTGATAGTTCCCCGTTGTAATTAAATGCTATCCCATAACCACAACTC
AGAAATATCGGAGTTCACGT

Downstream 100 bases:

>100_bases
TAACAGCCCGGGCCGCGTTTGCGGCCCTTCTTCTACCGGAGAGAATATGTATTACCCTGTGACAGACTATATCGCTCTTG
CTCTCATTATTAGCTTTCTT

Product: serine protease

Products: NA

Alternate protein names: Plasmid-encoded toxin pet [H]

Number of amino acids: Translated: 1285; Mature: 1285

Protein sequence:

>1285_residues
MNKIYSLKYSHITGGLVAVSELTRKVSVGTSRKKVILGIILSSIYGSYGETAFAAMLDINNIWTRDYLDLAQNRGEFRPG
ATNVQLMMKDGKIFHFPELPVPDFSAVSNKGATTSIGGAYSVTATHNGTQHHAITTQSWDQTAYKASNRVSSGDFSVHRL
NKFVVETTGVTESADFSLSPEDAMKRYGVNYNGKEQIIGFRAGAGTTSTILNGKQYLFGQNYNPDLLSASLFNLDWKNKS
YIYTNRTPFKNSPIFGDSGSGSYLYDKEQQKWVFHGVTSTVGFISSTNIAWTNYSLFNNILVNNLKKNFTNTMQLDGKKQ
ELSSIIKDKDLSVSGGGELTLKQDTDLGIGGLIFDKNQTYKVYGKDKSYKGAGIDIDNNTTVEWNVKGVAGDNLHKIGSG
TLDVKIAQGNNLKIGNGTVILSAEKAFNKIYMAGGKGTVKINAKDALSESGNGEIYFTRNGGTLDLNGYDQSFQKIAATD
AGTTVTNSNVKQSTLSLTNTDAYMYHGNVSGNISINHIINTTQQHNNNANLIFDGSVDIKNDISVRNAQLTLQGHATEHA
IFKEGNNNCPIPFLCQKDYSAAIKDQESTVNKRYNTEYKSNNQIASFSQPDWESRKFNFRKLNLENATLSIGRDANVKGH
IEAKNSQIVLGNKTAYIDMFSGRNITGEGFGFRQQLRSGDSAGESSFNGSLSAQNSKITVGDKSTVTMTGALSLINTDLI
INKGATVTAQGKMYVDKAIELAGTLTLTGTPTENNKYSPAIYMSDGYNMTEDGATLKAQNYAWVNGNIKSDKKASILFGV
DQYKEDNLDKTTHTPLATGLLGGFDTSYTGGIDAPAASASMYNTLWRVNGQSALQSLKTRDSLLLFSNIENSGFHTVTVN
TLDATNTAVIMRADLSQSVNQSDKLIVKNQLTGSNNSLSVDIQKVGNNNSGLNVDLITAPKGSNKEIFKASTQAIGFSNI
SPVISTKEDQEHTTWTLTGYKVAENTASSSAAKSYMSGNYKAFLTEVNNLNKRMGDLRDTNGEVGAWARIMSGAGSASGG
YSDNYTHVQIGVDKKHELDGLDLFTGLTMTYTDSHASSNAFSGKTKSVGAGLYASAIFDSGAYIDLISKYVHHDNEYSAT
FAGLGTKDYSSHSLYVGAEAGYRYHVTEDSWIEPQAELVYGAVSGKRFDWQDRGMSVTMKDKDFNPLIGRTGVDVGKSFS
GKDWKVTARAGLGYQFDLFANGETVLRDASGEKRIKGEKDGRILMNVGLNAEIRDNLRFGLEFEKSAFGKYNVDNAINAN
FRYSF

Sequences:

>Translated_1285_residues
MNKIYSLKYSHITGGLVAVSELTRKVSVGTSRKKVILGIILSSIYGSYGETAFAAMLDINNIWTRDYLDLAQNRGEFRPG
ATNVQLMMKDGKIFHFPELPVPDFSAVSNKGATTSIGGAYSVTATHNGTQHHAITTQSWDQTAYKASNRVSSGDFSVHRL
NKFVVETTGVTESADFSLSPEDAMKRYGVNYNGKEQIIGFRAGAGTTSTILNGKQYLFGQNYNPDLLSASLFNLDWKNKS
YIYTNRTPFKNSPIFGDSGSGSYLYDKEQQKWVFHGVTSTVGFISSTNIAWTNYSLFNNILVNNLKKNFTNTMQLDGKKQ
ELSSIIKDKDLSVSGGGELTLKQDTDLGIGGLIFDKNQTYKVYGKDKSYKGAGIDIDNNTTVEWNVKGVAGDNLHKIGSG
TLDVKIAQGNNLKIGNGTVILSAEKAFNKIYMAGGKGTVKINAKDALSESGNGEIYFTRNGGTLDLNGYDQSFQKIAATD
AGTTVTNSNVKQSTLSLTNTDAYMYHGNVSGNISINHIINTTQQHNNNANLIFDGSVDIKNDISVRNAQLTLQGHATEHA
IFKEGNNNCPIPFLCQKDYSAAIKDQESTVNKRYNTEYKSNNQIASFSQPDWESRKFNFRKLNLENATLSIGRDANVKGH
IEAKNSQIVLGNKTAYIDMFSGRNITGEGFGFRQQLRSGDSAGESSFNGSLSAQNSKITVGDKSTVTMTGALSLINTDLI
INKGATVTAQGKMYVDKAIELAGTLTLTGTPTENNKYSPAIYMSDGYNMTEDGATLKAQNYAWVNGNIKSDKKASILFGV
DQYKEDNLDKTTHTPLATGLLGGFDTSYTGGIDAPAASASMYNTLWRVNGQSALQSLKTRDSLLLFSNIENSGFHTVTVN
TLDATNTAVIMRADLSQSVNQSDKLIVKNQLTGSNNSLSVDIQKVGNNNSGLNVDLITAPKGSNKEIFKASTQAIGFSNI
SPVISTKEDQEHTTWTLTGYKVAENTASSSAAKSYMSGNYKAFLTEVNNLNKRMGDLRDTNGEVGAWARIMSGAGSASGG
YSDNYTHVQIGVDKKHELDGLDLFTGLTMTYTDSHASSNAFSGKTKSVGAGLYASAIFDSGAYIDLISKYVHHDNEYSAT
FAGLGTKDYSSHSLYVGAEAGYRYHVTEDSWIEPQAELVYGAVSGKRFDWQDRGMSVTMKDKDFNPLIGRTGVDVGKSFS
GKDWKVTARAGLGYQFDLFANGETVLRDASGEKRIKGEKDGRILMNVGLNAEIRDNLRFGLEFEKSAFGKYNVDNAINAN
FRYSF
>Mature_1285_residues
MNKIYSLKYSHITGGLVAVSELTRKVSVGTSRKKVILGIILSSIYGSYGETAFAAMLDINNIWTRDYLDLAQNRGEFRPG
ATNVQLMMKDGKIFHFPELPVPDFSAVSNKGATTSIGGAYSVTATHNGTQHHAITTQSWDQTAYKASNRVSSGDFSVHRL
NKFVVETTGVTESADFSLSPEDAMKRYGVNYNGKEQIIGFRAGAGTTSTILNGKQYLFGQNYNPDLLSASLFNLDWKNKS
YIYTNRTPFKNSPIFGDSGSGSYLYDKEQQKWVFHGVTSTVGFISSTNIAWTNYSLFNNILVNNLKKNFTNTMQLDGKKQ
ELSSIIKDKDLSVSGGGELTLKQDTDLGIGGLIFDKNQTYKVYGKDKSYKGAGIDIDNNTTVEWNVKGVAGDNLHKIGSG
TLDVKIAQGNNLKIGNGTVILSAEKAFNKIYMAGGKGTVKINAKDALSESGNGEIYFTRNGGTLDLNGYDQSFQKIAATD
AGTTVTNSNVKQSTLSLTNTDAYMYHGNVSGNISINHIINTTQQHNNNANLIFDGSVDIKNDISVRNAQLTLQGHATEHA
IFKEGNNNCPIPFLCQKDYSAAIKDQESTVNKRYNTEYKSNNQIASFSQPDWESRKFNFRKLNLENATLSIGRDANVKGH
IEAKNSQIVLGNKTAYIDMFSGRNITGEGFGFRQQLRSGDSAGESSFNGSLSAQNSKITVGDKSTVTMTGALSLINTDLI
INKGATVTAQGKMYVDKAIELAGTLTLTGTPTENNKYSPAIYMSDGYNMTEDGATLKAQNYAWVNGNIKSDKKASILFGV
DQYKEDNLDKTTHTPLATGLLGGFDTSYTGGIDAPAASASMYNTLWRVNGQSALQSLKTRDSLLLFSNIENSGFHTVTVN
TLDATNTAVIMRADLSQSVNQSDKLIVKNQLTGSNNSLSVDIQKVGNNNSGLNVDLITAPKGSNKEIFKASTQAIGFSNI
SPVISTKEDQEHTTWTLTGYKVAENTASSSAAKSYMSGNYKAFLTEVNNLNKRMGDLRDTNGEVGAWARIMSGAGSASGG
YSDNYTHVQIGVDKKHELDGLDLFTGLTMTYTDSHASSNAFSGKTKSVGAGLYASAIFDSGAYIDLISKYVHHDNEYSAT
FAGLGTKDYSSHSLYVGAEAGYRYHVTEDSWIEPQAELVYGAVSGKRFDWQDRGMSVTMKDKDFNPLIGRTGVDVGKSFS
GKDWKVTARAGLGYQFDLFANGETVLRDASGEKRIKGEKDGRILMNVGLNAEIRDNLRFGLEFEKSAFGKYNVDNAINAN
FRYSF

Specific function: Serine protease with enterotoxic and cytotoxic activity. Internalization into the host cell is required for the induction of cytopathic effects. However, the serine activity is not necessary for secretion and internalization into the host cell [H]

COG id: COG3468

COG function: function code MU; Type V secretory pathway, adhesin AidA

Gene ontology:

Cell location: Serine protease pet translocator:Cell outer membrane; Multi-pass membrane protein. Note=The cleaved C-terminal fragment (autotransporter domain) is localized in the outer membrane (By similarity) [H]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 peptidase S6 domain [H]

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR005546
- InterPro:   IPR006315
- InterPro:   IPR012332
- InterPro:   IPR011050
- InterPro:   IPR000710 [H]

Pfam domain/function: PF03797 Autotransporter; PF02395 Peptidase_S6 [H]

EC number: NA

Molecular weight: Translated: 139765; Mature: 139765

Theoretical pI: Translated: 8.50; Mature: 8.50

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.2 %Cys     (Translated Protein)
1.7 %Met     (Translated Protein)
1.9 %Cys+Met (Translated Protein)
0.2 %Cys     (Mature Protein)
1.7 %Met     (Mature Protein)
1.9 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MNKIYSLKYSHITGGLVAVSELTRKVSVGTSRKKVILGIILSSIYGSYGETAFAAMLDIN
CCCEEEEEECCCCCCHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHCCCCCCEEEEEEECC
NIWTRDYLDLAQNRGEFRPGATNVQLMMKDGKIFHFPELPVPDFSAVSNKGATTSIGGAY
CCCCHHHHHHHHCCCCCCCCCCCEEEEEECCCEEECCCCCCCCCHHHCCCCCCEECCCEE
SVTATHNGTQHHAITTQSWDQTAYKASNRVSSGDFSVHRLNKFVVETTGVTESADFSLSP
EEEEECCCCEEEEEECCCCCHHHHHHCCCCCCCCCCCEEEEEEEEEECCCCCCCCCCCCH
EDAMKRYGVNYNGKEQIIGFRAGAGTTSTILNGKQYLFGQNYNPDLLSASLFNLDWKNKS
HHHHHHCCCCCCCCEEEEEEECCCCCHHHEECCCEEEECCCCCCCHHEEEEEEECCCCCE
YIYTNRTPFKNSPIFGDSGSGSYLYDKEQQKWVFHGVTSTVGFISSTNIAWTNYSLFNNI
EEEECCCCCCCCCCCCCCCCCCEEECCCCCEEEEEEHHHHHHEEECCCEEEEEHHHHHHH
LVNNLKKNFTNTMQLDGKKQELSSIIKDKDLSVSGGGELTLKQDTDLGIGGLIFDKNQTY
HHHHHHHHCCCEEEECCCHHHHHHHHCCCCCEECCCCEEEEEECCCCCCCEEEECCCCEE
KVYGKDKSYKGAGIDIDNNTTVEWNVKGVAGDNLHKIGSGTLDVKIAQGNNLKIGNGTVI
EEEECCCCCCCCCEECCCCCEEEEEEEEECCCCCEECCCCEEEEEEECCCEEEECCCEEE
LSAEKAFNKIYMAGGKGTVKINAKDALSESGNGEIYFTRNGGTLDLNGYDQSFQKIAATD
EEEHHCCCEEEEECCCEEEEEECHHHHCCCCCCEEEEEECCCEEEECCCCHHHHHHHCCC
AGTTVTNSNVKQSTLSLTNTDAYMYHGNVSGNISINHIINTTQQHNNNANLIFDGSVDIK
CCCEEECCCCCEEEEEEECCCEEEEECCCCCCEEEEEEEECCHHCCCCCCEEEECCCCCC
NDISVRNAQLTLQGHATEHAIFKEGNNNCPIPFLCQKDYSAAIKDQESTVNKRYNTEYKS
CCCEEEEEEEEEECCCCCEEEEECCCCCCCCCEEECCCCCHHHCCCHHHHHHHCCCCCCC
NNQIASFSQPDWESRKFNFRKLNLENATLSIGRDANVKGHIEAKNSQIVLGNKTAYIDMF
CCCEEECCCCCCCCCCEEEEEEEECCCEEEECCCCCCEEEEEECCCEEEEECCEEEEEEE
SGRNITGEGFGFRQQLRSGDSAGESSFNGSLSAQNSKITVGDKSTVTMTGALSLINTDLI
CCCCCCCCCCCHHHHHHCCCCCCCCCCCCCEECCCCEEEECCCCEEEEEEEEEEEEEEEE
INKGATVTAQGKMYVDKAIELAGTLTLTGTPTENNKYSPAIYMSDGYNMTEDGATLKAQN
EECCCEEEECCCEEEEEHEEEEEEEEEECCCCCCCCCCCEEEECCCCCCCCCCCEEEECC
YAWVNGNIKSDKKASILFGVDQYKEDNLDKTTHTPLATGLLGGFDTSYTGGIDAPAASAS
EEEECCCCCCCCCEEEEEECHHHCCCCCCCCCCCCHHHHHHCCCCCCCCCCCCCCCCHHH
MYNTLWRVNGQSALQSLKTRDSLLLFSNIENSGFHTVTVNTLDATNTAVIMRADLSQSVN
HHHHEEEECCHHHHHHHHCCCCEEEEECCCCCCEEEEEEEEECCCCEEEEEEECCHHHCC
QSDKLIVKNQLTGSNNSLSVDIQKVGNNNSGLNVDLITAPKGSNKEIFKASTQAIGFSNI
CCCCEEEEEECCCCCCEEEEEEEECCCCCCCCEEEEEECCCCCCCHHEEEHHHEECCCCC
SPVISTKEDQEHTTWTLTGYKVAENTASSSAAKSYMSGNYKAFLTEVNNLNKRMGDLRDT
CCCEECCCCCCCEEEEEEEEEEECCCCCHHHHHHHHCCCEEEEEEHHHHHHHHHCCCCCC
NGEVGAWARIMSGAGSASGGYSDNYTHVQIGVDKKHELDGLDLFTGLTMTYTDSHASSNA
CCCHHHHHHHHCCCCCCCCCCCCCEEEEEEECCCCCCCCCEEEHHCCEEEEECCCCCCCC
FSGKTKSVGAGLYASAIFDSGAYIDLISKYVHHDNEYSATFAGLGTKDYSSHSLYVGAEA
CCCCCCCCCCCEEEEHHHCCCCHHHHHHHHHHCCCCCCEEEEECCCCCCCCCEEEEECCC
GYRYHVTEDSWIEPQAELVYGAVSGKRFDWQDRGMSVTMKDKDFNPLIGRTGVDVGKSFS
CEEEEECCCCCCCCCHHEEEEECCCCCCCHHCCCCEEEEECCCCCCCCCCCCCCCCCCCC
GKDWKVTARAGLGYQFDLFANGETVLRDASGEKRIKGEKDGRILMNVGLNAEIRDNLRFG
CCCEEEEEECCCCEEEEEEECCCEEEECCCCCCCCCCCCCCEEEEEECCCCEECCCEEEC
LEFEKSAFGKYNVDNAINANFRYSF
EEECCCCCCCCCCCCCCCCCEEECC
>Mature Secondary Structure
MNKIYSLKYSHITGGLVAVSELTRKVSVGTSRKKVILGIILSSIYGSYGETAFAAMLDIN
CCCEEEEEECCCCCCHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHCCCCCCEEEEEEECC
NIWTRDYLDLAQNRGEFRPGATNVQLMMKDGKIFHFPELPVPDFSAVSNKGATTSIGGAY
CCCCHHHHHHHHCCCCCCCCCCCEEEEEECCCEEECCCCCCCCCHHHCCCCCCEECCCEE
SVTATHNGTQHHAITTQSWDQTAYKASNRVSSGDFSVHRLNKFVVETTGVTESADFSLSP
EEEEECCCCEEEEEECCCCCHHHHHHCCCCCCCCCCCEEEEEEEEEECCCCCCCCCCCCH
EDAMKRYGVNYNGKEQIIGFRAGAGTTSTILNGKQYLFGQNYNPDLLSASLFNLDWKNKS
HHHHHHCCCCCCCCEEEEEEECCCCCHHHEECCCEEEECCCCCCCHHEEEEEEECCCCCE
YIYTNRTPFKNSPIFGDSGSGSYLYDKEQQKWVFHGVTSTVGFISSTNIAWTNYSLFNNI
EEEECCCCCCCCCCCCCCCCCCEEECCCCCEEEEEEHHHHHHEEECCCEEEEEHHHHHHH
LVNNLKKNFTNTMQLDGKKQELSSIIKDKDLSVSGGGELTLKQDTDLGIGGLIFDKNQTY
HHHHHHHHCCCEEEECCCHHHHHHHHCCCCCEECCCCEEEEEECCCCCCCEEEECCCCEE
KVYGKDKSYKGAGIDIDNNTTVEWNVKGVAGDNLHKIGSGTLDVKIAQGNNLKIGNGTVI
EEEECCCCCCCCCEECCCCCEEEEEEEEECCCCCEECCCCEEEEEEECCCEEEECCCEEE
LSAEKAFNKIYMAGGKGTVKINAKDALSESGNGEIYFTRNGGTLDLNGYDQSFQKIAATD
EEEHHCCCEEEEECCCEEEEEECHHHHCCCCCCEEEEEECCCEEEECCCCHHHHHHHCCC
AGTTVTNSNVKQSTLSLTNTDAYMYHGNVSGNISINHIINTTQQHNNNANLIFDGSVDIK
CCCEEECCCCCEEEEEEECCCEEEEECCCCCCEEEEEEEECCHHCCCCCCEEEECCCCCC
NDISVRNAQLTLQGHATEHAIFKEGNNNCPIPFLCQKDYSAAIKDQESTVNKRYNTEYKS
CCCEEEEEEEEEECCCCCEEEEECCCCCCCCCEEECCCCCHHHCCCHHHHHHHCCCCCCC
NNQIASFSQPDWESRKFNFRKLNLENATLSIGRDANVKGHIEAKNSQIVLGNKTAYIDMF
CCCEEECCCCCCCCCCEEEEEEEECCCEEEECCCCCCEEEEEECCCEEEEECCEEEEEEE
SGRNITGEGFGFRQQLRSGDSAGESSFNGSLSAQNSKITVGDKSTVTMTGALSLINTDLI
CCCCCCCCCCCHHHHHHCCCCCCCCCCCCCEECCCCEEEECCCCEEEEEEEEEEEEEEEE
INKGATVTAQGKMYVDKAIELAGTLTLTGTPTENNKYSPAIYMSDGYNMTEDGATLKAQN
EECCCEEEECCCEEEEEHEEEEEEEEEECCCCCCCCCCCEEEECCCCCCCCCCCEEEECC
YAWVNGNIKSDKKASILFGVDQYKEDNLDKTTHTPLATGLLGGFDTSYTGGIDAPAASAS
EEEECCCCCCCCCEEEEEECHHHCCCCCCCCCCCCHHHHHHCCCCCCCCCCCCCCCCHHH
MYNTLWRVNGQSALQSLKTRDSLLLFSNIENSGFHTVTVNTLDATNTAVIMRADLSQSVN
HHHHEEEECCHHHHHHHHCCCCEEEEECCCCCCEEEEEEEEECCCCEEEEEEECCHHHCC
QSDKLIVKNQLTGSNNSLSVDIQKVGNNNSGLNVDLITAPKGSNKEIFKASTQAIGFSNI
CCCCEEEEEECCCCCCEEEEEEEECCCCCCCCEEEEEECCCCCCCHHEEEHHHEECCCCC
SPVISTKEDQEHTTWTLTGYKVAENTASSSAAKSYMSGNYKAFLTEVNNLNKRMGDLRDT
CCCEECCCCCCCEEEEEEEEEEECCCCCHHHHHHHHCCCEEEEEEHHHHHHHHHCCCCCC
NGEVGAWARIMSGAGSASGGYSDNYTHVQIGVDKKHELDGLDLFTGLTMTYTDSHASSNA
CCCHHHHHHHHCCCCCCCCCCCCCEEEEEEECCCCCCCCCEEEHHCCEEEEECCCCCCCC
FSGKTKSVGAGLYASAIFDSGAYIDLISKYVHHDNEYSATFAGLGTKDYSSHSLYVGAEA
CCCCCCCCCCCEEEEHHHCCCCHHHHHHHHHHCCCCCCEEEEECCCCCCCCCEEEEECCC
GYRYHVTEDSWIEPQAELVYGAVSGKRFDWQDRGMSVTMKDKDFNPLIGRTGVDVGKSFS
CEEEEECCCCCCCCCHHEEEEECCCCCCCHHCCCCEEEEECCCCCCCCCCCCCCCCCCCC
GKDWKVTARAGLGYQFDLFANGETVLRDASGEKRIKGEKDGRILMNVGLNAEIRDNLRFG
CCCEEEEEECCCCEEEEEEECCCEEEECCCCCCCCCCCCCCEEEEEECCCCEECCCEEEC
LEFEKSAFGKYNVDNAINANFRYSF
EEECCCCCCCCCCCCCCCCCEEECC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 9632580 [H]