Definition Xylella fastidiosa M23 chromosome, complete genome.
Accession NC_010577
Length 2,535,690

Click here to switch to the map view.

The map label for this gene is 182681422

Identifier: 182681422

GI number: 182681422

Start: 1025845

End: 1030167

Strand: Direct

Name: 182681422

Synonym: XfasM23_0872

Alternate gene names: NA

Gene position: 1025845-1030167 (Clockwise)

Preceding gene: 182681419

Following gene: 182681423

Centisome position: 40.46

GC content: 51.1

Gene sequence:

>4323_bases
ATGCAAATTCATACTGCACTGCCCATGGTTCGGTTGGGTGGAATCGAAGGTGTTGATCCATTATTTTTGCCGAAATACAA
GATCGGTCGGTCGCTGCAACACGCAGTGATGACATCAGCAGCTTCAAGTAAAAAAGGTACGCAGCCACGACGTTCCAACA
ATGCGATGACAGCTAAGCGTAGCGCGAAACCGCACGACCGGAGGCAGTTGCATATTGTCTTATTGACAGTGCTTGCAGCC
TCAACGGGATATACGGGGAAAGTATCAGCTCAAGTCTATGTAAATTCCGACTCGACTGAAAATTGCGTAGAAATACTGGG
CGACAGTAGTCAGACATCCTTCATTCATAGTGCTTCTAACGATAAATGCAAGCCAGATTTCACACAAACAGAGTATTCCC
TGTTTTATGACTATAGAAACCTGGTTCTTGGTGGGTCCTTATATGTCAATGAGGGTAAACTCGGGCTAGTCGATATTTCT
GGTGCAACTTATTCTATGCGCCTAGGCAGCATTGCTACCATGAATGGCTCGGCTGGCATAGATTCGATTGCCATCGGTTC
AGGGCAAGGTTCCCAAACGGACGGGAATACCAGCGGCGCCACTGTAGCACAGGGACTGCGTTCGATTGCGATTGGTACTA
CGGCCCGTTCGCAATCTCAAGATGCGATTTCTATAGGGACCGGTGCATCCACTACAGGCAATTTTGCGATAGCGATAGGT
AATGGAGCATTGACATCAATTGCCAATGGGATAGCGCTTGGTGCATCAAGCAGTGTCACCACAAGAGGAGGTGTGGCACT
GGGACAAGGCTCGCTGGCTGCGACCGCTTCTGGCATTACTGGCTATGATCCGGTCACCAAGAGCACCTCGACTCTTTCCA
CTTCAATATGGAGAAGCACGCTGGGGGCAGTCAGTATCGGTAATATAACCTCTAGCACCTCCCAGACACGTCAACTTACA
GGATTGGCGGCAGGTAGGTCAGATACGGATGCGGTGAATGTTGCCCAGCTGAAGTTGCTTGCTGAATCTGTGGGTGGTGG
TTGGAATTTGACTGCTTCTGGAGCCAACAGCAGTAATGTGGCGCTGGGTGAGTCGGTAGATTTGAAGAATAGTGACGGAA
ACCTCTTAATCACCAAAGCAACCGACAGCAATGATGTGACTTTTAATTTGGCCACTGCTTTAAAAGTGGACAGTTTGACC
ACTGGCAACACGGCGATGACGACCGATGGTGTGACGGTGGGCAAGAGAGTTACCTTGGATTCGACAGGATTAGTGATTGC
GGAAGGTCCCTCGGTAATCAGTTCGGGCATTAATGCTGCCGGCCAAAAGATCATCAATGTTGGAACGGGTACTGCGGATA
CAGACGCCGTCAACTTCGGTCAGCTGCAAGCGGTGAGCGATACAGCAAGCAAGGGCTGGAATTTGCTAGCTTCTGGAGCC
AACAGCAGTAATGTGGCGCCGGGTGAGTCGGTGGATCTGAAGAATAGTGATGGGAACCTCTTAATCACCAAAACAACCGA
TAGCAATGATGTGACTTTTAATTTGGCCACTGCTTTAGAAGTGGACAGTTTGACCACTGGCAACACGGCGATGACGACCG
ATGGTGTGGCGGTGGGTAGTAACGTGAAGTTGGGCTCGACGGGATTAGTTATTACAGATGGTCCGTCTGTGACCAGCTCG
GGCATTAGCGCCGGTAACCAAAAGATAACGAATGTTGCCGCAGGTACTGCGGATACCGATGCCGTCAACTTTAGCCAGTT
GCAAGCGGTGAGCAGTACGGCCAGTAAGGGGTGGAATTTGCTGGCTTCTGGAGCCAACAGTAGTAATGTGGCGCCGGGTG
GGTCGGTGGATCTGAAGAATAGTGATGGGAACCTCTTAATCACCAAAACAACCGACAGCAATGATGTGACTTTTAATTTG
GCCACTGCTTTAGAAGTGGACAGTTTGACCACTGGCAACACGGCGATGACGACCGATGGTGTGGCGGTGGGTAGTAACGT
GAAGTTGGGCTCGACGGGATTAGTTATTACAGATGGTCCGTCTGTGACCAGCTCGGGCATTAGCGCCGGTAACCAAAAGA
TAACGAATGTTGCCGCAGGTACTGCAGATACCGATGTCGTCAACTTTAGCCAGTTGCAAGCGGTGAGCAGTACGGCCAGT
AAGGGGTGGAATTTGCTGGCTTCTGGAGCCAACAGTAGTAATGTGGCGCCGGGTGGGTCGGTGGATCTGAAGAATAGTGA
TGGGAACCTCTTAATCACCAAAACAACCGACAGCAATGATGTGACTTTTAATTTGGCCACTGCTTTAGAAGTGGACAGTT
TGACCACTGGCAACACGGCGATGACGACCGATGGTGTGGCGGTGGGTAGTAACGTGAAGTTGGGCTCGACGGGATTAGTT
ATTACAGATGGTCCGTCTGTGACCAGCTCGGGCATTAGCGCCGGTAACCAAAAGATAACGAATGTTGCCGCAGGTACTGC
AGATACCGATGTCGTCAACTTTAGCCAGTTGCAAGCGGTGAGCAGTACGGCCAGTAAGGGGTGGAATTTGCTGGCTTCTG
GAGCCAACAGTAGTAATGTGGCGCCGGGTGGGTCGGTGGATCTGAAGAATAGTGATGGGAACCTCTTAATCACCAAAACA
ACCGACAGCAATGATGTGACTTTTAATTTGGCCACTGCTTTAGAAGTGGACAGTTTGACCACTGGCAACACGGCGATGAC
GACCGATGGTGTGGCGGTGGGTAGTAACGTGAAGTTGGGCTCGACGGGATTAGTTATTACAGATGGTCCGTCTGTGACCA
GCTCGGGCATTAGCGCCGGTAACCAAAAGATAACGAATGTTGCCGCAGGTACTGCAGATACCGATGCCGTCAACTTTAGC
CAGTTGCAAGCGGTGAGCAGTACGGCCAGTAAGGGGTGGAATTTGCTGGCTTCTGGAGCCAACAGTAGTAATGTGGCGCC
GGGTGAGTCGGTAGACCTGAAGAATACCGATGGAAACATCGTTATCAGCAAAGAAAGCGGCAGCAATGATGTGCTTTTCA
ATCTGTCCAGCAGTTTGAAGCTGGACAAATTGACCGTTGGCGACACGGTGATGACGACCAATGGTGTGACAGTGGGGAGT
GGCGTGACGTTGGGTTCGATGGGATTAGTTATTACGGATGGTCCCTCGGTGACCAGTTCTGGTATTAATGCTGGCAGCCA
AAAGATAACGAATGTTGCCGCAGGTACTGCGGACACGGATGCTGTTAATCTTAGCCAACTTAATACTGCAATGGCGAGCT
CCGGCGCTAAATCAGTCCATTACTACAGTACATATGATGGTGGTACCCAAGGAGGTAACTACAATGGTGATGGTGCGACA
GGCACTGGGTCTATAGCCGTTGGTGTTGGCACGCTTGCATCCGCTGAAGGAGCGACAGCAATCGGTTCAGGGGCGGCGGC
TAGTGGGAAAGGCTCCACGGCGATCGGTCGTAACGCAGTTGCCAGCGCTGATGGTAGCGTGGCCTTGGGCGATGGTGCAA
AAGATGGTGCGCGTGGGGCAGAGAGTTACACCGGTAAATATTCAGGCGTACAGAACAATACGGTGGGAACTGTTTCGGTA
GGTGATGCTTCCAAGGGTGAAACCCGCACAGTGAGTAATGTGGCTGATGCCAAAGAAGCGACGGATGCGGTGAATTTGCG
TCAGCTTGATCAAGTGGCTCAAGATGCCAATCGTTATGTTGATAACAAGATAGAAAGCCTTAGCGAAGGGCAGACTTTCG
TTAAGGTGAACAGCGTGAACAATAGTGCCACTCCTATTGCAGCTGGAGTCGATGCAACAGCGATTGGTGTCGGTGCCACC
GCTTCTGGTGCCGATAGCATTGCAATGGGTAATAAAGCCAGTGCGTCTGCTGACAATGCGGTTGCCATTGGTAACCATTC
AGTAGCCGACCGTGCAAACACTGTTTCTGTGGGATCGGCTGGTTCTGAGAGGCAGGTGACGAATGTAGCCGCTGGCACTG
CTGATACTGATGCGGTCAATGTAAGCCAACTCAATCAAGGCTTGATCACTGCCAAACAGTATACGGATGGGGTTGTAGGG
AGTCTTCGTAGGGATACTGACGGTGGTGTGGCGGCAGCAATTGCAACAGCAAATCTCCCACAGGCTTATATTCCGGGACG
CGGGATGACCTCCGTAGGCGTTAGTAGTTACCGAGGGCAATCTGCCATTGCGGTGGGTGTTTCTTCGGTTTCTGAAAGCG
GACGTTGGGTATTCAAGTTCAGCGGTAGTGCAAATACCCGTAGTCAAGTGGGTATTGGTGCAGGTGTGGGTTATCAGTGG
TAA

Upstream 100 bases:

>100_bases
AATTTGCTCAATCTTAATTCTATTGGCAGTTCTTAAAATCCACAGTAATTCATAGTCTCAAATGCTCGGTGTTGCCGAGC
CAAAGTTAAGGAGTATTGTT

Downstream 100 bases:

>100_bases
ATACAGGTTTTCAGCAATGAAAACGTTTAGGACGGGGGGGTAGTTTCCCCCGTCCTATTTTTTTGGTGCATGGTTCTGTA
ATGAATTGCACCTATTGTCG

Product: YadA domain-containing protein

Products: NA

Alternate protein names: YadA Domain Protein; Adhesin; Outer Membrane Protein; Autotransporter Adhesin; Surface Protein; Cell Surface Protein; Large Adhesin; Haemagglutinin-Related Autotransporter Protein; Hemagglutinin Family Protein; Surface Protein/Bartonella Adhesin; Haemagluttinin Domain Protein; Haemagglutinin; Haemagluttinin Family Protein; Hep_Hag Superfamily; Membrane-Anchored Cell Surface Protein; Haemagglutinin Family Protein; YadA-Like Protein; Surface Fibril Protein; Surface-Exposed Protein; Hemagglutinin Superfamily; Hep_Hag Family; YadA-Like C-Terminal Domain-Containing; Hemagglutinin Domain-Containing Protein; Hemagluttinin Domain-Containing Protein; YadA C-Terminal Domain Protein; Hep_Hag Family Protein; Autotransporter; Peptide Transport System Permease SapB; Brp Family Immunodominant Surface Antigen; Hemagluttinin Domain Protein; Surface-Exposed Adhesin Protein; YadA-Like Haemagluttinin; YadA-Like C-Terminal Region Protein; Adhesin XadA; Hemagluttinin-Like Protein; Membrane-Anchored Cell Surface Protein Haemagluttinin; Hemagglutinin; Haemagglutinin And Invasin Like Cell Surface Protein; Outer Membrane Pathogenesis Protein; Intracellular Motility Protein A; Adhesin/Hemagglutinin; Hemagglutinin-Related Protein; Xanthomonas Adhesin Protein; Autotransporter/Adhesin; Extracellular Matrix Protein Adhesin A; Hemagluttinin Family Protein; Inner Membrane Protein; S-Layer Domain Protein; S-Layer-Like Domain Protein; Haemagglutinin/Invasin; YadA/Haemagluttinin Like Protein; Surface Protein/Adhesin; Pe-Pgrs Family Protein; Hemaglutinin/Autotransporter Like Protein; Exported Adhesin; Haemagglutinin-Like Protein; Hemagluttinin Like Protein; Triple Helix Repeat-Containing Collagen; Repetitive Surface Protein; Haemagglutinin Adhesin; Hemagluttinin Motif-Containing Protein; Hemagluttinin/Autotransporter Adhesin; Outer Membrane Protein Autotransporter And Adhesin; AT Family Autotransporter/Adhesin; Hsf-Like Protein

Number of amino acids: Translated: 1440; Mature: 1440

Protein sequence:

>1440_residues
MQIHTALPMVRLGGIEGVDPLFLPKYKIGRSLQHAVMTSAASSKKGTQPRRSNNAMTAKRSAKPHDRRQLHIVLLTVLAA
STGYTGKVSAQVYVNSDSTENCVEILGDSSQTSFIHSASNDKCKPDFTQTEYSLFYDYRNLVLGGSLYVNEGKLGLVDIS
GATYSMRLGSIATMNGSAGIDSIAIGSGQGSQTDGNTSGATVAQGLRSIAIGTTARSQSQDAISIGTGASTTGNFAIAIG
NGALTSIANGIALGASSSVTTRGGVALGQGSLAATASGITGYDPVTKSTSTLSTSIWRSTLGAVSIGNITSSTSQTRQLT
GLAAGRSDTDAVNVAQLKLLAESVGGGWNLTASGANSSNVALGESVDLKNSDGNLLITKATDSNDVTFNLATALKVDSLT
TGNTAMTTDGVTVGKRVTLDSTGLVIAEGPSVISSGINAAGQKIINVGTGTADTDAVNFGQLQAVSDTASKGWNLLASGA
NSSNVAPGESVDLKNSDGNLLITKTTDSNDVTFNLATALEVDSLTTGNTAMTTDGVAVGSNVKLGSTGLVITDGPSVTSS
GISAGNQKITNVAAGTADTDAVNFSQLQAVSSTASKGWNLLASGANSSNVAPGGSVDLKNSDGNLLITKTTDSNDVTFNL
ATALEVDSLTTGNTAMTTDGVAVGSNVKLGSTGLVITDGPSVTSSGISAGNQKITNVAAGTADTDVVNFSQLQAVSSTAS
KGWNLLASGANSSNVAPGGSVDLKNSDGNLLITKTTDSNDVTFNLATALEVDSLTTGNTAMTTDGVAVGSNVKLGSTGLV
ITDGPSVTSSGISAGNQKITNVAAGTADTDVVNFSQLQAVSSTASKGWNLLASGANSSNVAPGGSVDLKNSDGNLLITKT
TDSNDVTFNLATALEVDSLTTGNTAMTTDGVAVGSNVKLGSTGLVITDGPSVTSSGISAGNQKITNVAAGTADTDAVNFS
QLQAVSSTASKGWNLLASGANSSNVAPGESVDLKNTDGNIVISKESGSNDVLFNLSSSLKLDKLTVGDTVMTTNGVTVGS
GVTLGSMGLVITDGPSVTSSGINAGSQKITNVAAGTADTDAVNLSQLNTAMASSGAKSVHYYSTYDGGTQGGNYNGDGAT
GTGSIAVGVGTLASAEGATAIGSGAAASGKGSTAIGRNAVASADGSVALGDGAKDGARGAESYTGKYSGVQNNTVGTVSV
GDASKGETRTVSNVADAKEATDAVNLRQLDQVAQDANRYVDNKIESLSEGQTFVKVNSVNNSATPIAAGVDATAIGVGAT
ASGADSIAMGNKASASADNAVAIGNHSVADRANTVSVGSAGSERQVTNVAAGTADTDAVNVSQLNQGLITAKQYTDGVVG
SLRRDTDGGVAAAIATANLPQAYIPGRGMTSVGVSSYRGQSAIAVGVSSVSESGRWVFKFSGSANTRSQVGIGAGVGYQW

Sequences:

>Translated_1440_residues
MQIHTALPMVRLGGIEGVDPLFLPKYKIGRSLQHAVMTSAASSKKGTQPRRSNNAMTAKRSAKPHDRRQLHIVLLTVLAA
STGYTGKVSAQVYVNSDSTENCVEILGDSSQTSFIHSASNDKCKPDFTQTEYSLFYDYRNLVLGGSLYVNEGKLGLVDIS
GATYSMRLGSIATMNGSAGIDSIAIGSGQGSQTDGNTSGATVAQGLRSIAIGTTARSQSQDAISIGTGASTTGNFAIAIG
NGALTSIANGIALGASSSVTTRGGVALGQGSLAATASGITGYDPVTKSTSTLSTSIWRSTLGAVSIGNITSSTSQTRQLT
GLAAGRSDTDAVNVAQLKLLAESVGGGWNLTASGANSSNVALGESVDLKNSDGNLLITKATDSNDVTFNLATALKVDSLT
TGNTAMTTDGVTVGKRVTLDSTGLVIAEGPSVISSGINAAGQKIINVGTGTADTDAVNFGQLQAVSDTASKGWNLLASGA
NSSNVAPGESVDLKNSDGNLLITKTTDSNDVTFNLATALEVDSLTTGNTAMTTDGVAVGSNVKLGSTGLVITDGPSVTSS
GISAGNQKITNVAAGTADTDAVNFSQLQAVSSTASKGWNLLASGANSSNVAPGGSVDLKNSDGNLLITKTTDSNDVTFNL
ATALEVDSLTTGNTAMTTDGVAVGSNVKLGSTGLVITDGPSVTSSGISAGNQKITNVAAGTADTDVVNFSQLQAVSSTAS
KGWNLLASGANSSNVAPGGSVDLKNSDGNLLITKTTDSNDVTFNLATALEVDSLTTGNTAMTTDGVAVGSNVKLGSTGLV
ITDGPSVTSSGISAGNQKITNVAAGTADTDVVNFSQLQAVSSTASKGWNLLASGANSSNVAPGGSVDLKNSDGNLLITKT
TDSNDVTFNLATALEVDSLTTGNTAMTTDGVAVGSNVKLGSTGLVITDGPSVTSSGISAGNQKITNVAAGTADTDAVNFS
QLQAVSSTASKGWNLLASGANSSNVAPGESVDLKNTDGNIVISKESGSNDVLFNLSSSLKLDKLTVGDTVMTTNGVTVGS
GVTLGSMGLVITDGPSVTSSGINAGSQKITNVAAGTADTDAVNLSQLNTAMASSGAKSVHYYSTYDGGTQGGNYNGDGAT
GTGSIAVGVGTLASAEGATAIGSGAAASGKGSTAIGRNAVASADGSVALGDGAKDGARGAESYTGKYSGVQNNTVGTVSV
GDASKGETRTVSNVADAKEATDAVNLRQLDQVAQDANRYVDNKIESLSEGQTFVKVNSVNNSATPIAAGVDATAIGVGAT
ASGADSIAMGNKASASADNAVAIGNHSVADRANTVSVGSAGSERQVTNVAAGTADTDAVNVSQLNQGLITAKQYTDGVVG
SLRRDTDGGVAAAIATANLPQAYIPGRGMTSVGVSSYRGQSAIAVGVSSVSESGRWVFKFSGSANTRSQVGIGAGVGYQW
>Mature_1440_residues
MQIHTALPMVRLGGIEGVDPLFLPKYKIGRSLQHAVMTSAASSKKGTQPRRSNNAMTAKRSAKPHDRRQLHIVLLTVLAA
STGYTGKVSAQVYVNSDSTENCVEILGDSSQTSFIHSASNDKCKPDFTQTEYSLFYDYRNLVLGGSLYVNEGKLGLVDIS
GATYSMRLGSIATMNGSAGIDSIAIGSGQGSQTDGNTSGATVAQGLRSIAIGTTARSQSQDAISIGTGASTTGNFAIAIG
NGALTSIANGIALGASSSVTTRGGVALGQGSLAATASGITGYDPVTKSTSTLSTSIWRSTLGAVSIGNITSSTSQTRQLT
GLAAGRSDTDAVNVAQLKLLAESVGGGWNLTASGANSSNVALGESVDLKNSDGNLLITKATDSNDVTFNLATALKVDSLT
TGNTAMTTDGVTVGKRVTLDSTGLVIAEGPSVISSGINAAGQKIINVGTGTADTDAVNFGQLQAVSDTASKGWNLLASGA
NSSNVAPGESVDLKNSDGNLLITKTTDSNDVTFNLATALEVDSLTTGNTAMTTDGVAVGSNVKLGSTGLVITDGPSVTSS
GISAGNQKITNVAAGTADTDAVNFSQLQAVSSTASKGWNLLASGANSSNVAPGGSVDLKNSDGNLLITKTTDSNDVTFNL
ATALEVDSLTTGNTAMTTDGVAVGSNVKLGSTGLVITDGPSVTSSGISAGNQKITNVAAGTADTDVVNFSQLQAVSSTAS
KGWNLLASGANSSNVAPGGSVDLKNSDGNLLITKTTDSNDVTFNLATALEVDSLTTGNTAMTTDGVAVGSNVKLGSTGLV
ITDGPSVTSSGISAGNQKITNVAAGTADTDVVNFSQLQAVSSTASKGWNLLASGANSSNVAPGGSVDLKNSDGNLLITKT
TDSNDVTFNLATALEVDSLTTGNTAMTTDGVAVGSNVKLGSTGLVITDGPSVTSSGISAGNQKITNVAAGTADTDAVNFS
QLQAVSSTASKGWNLLASGANSSNVAPGESVDLKNTDGNIVISKESGSNDVLFNLSSSLKLDKLTVGDTVMTTNGVTVGS
GVTLGSMGLVITDGPSVTSSGINAGSQKITNVAAGTADTDAVNLSQLNTAMASSGAKSVHYYSTYDGGTQGGNYNGDGAT
GTGSIAVGVGTLASAEGATAIGSGAAASGKGSTAIGRNAVASADGSVALGDGAKDGARGAESYTGKYSGVQNNTVGTVSV
GDASKGETRTVSNVADAKEATDAVNLRQLDQVAQDANRYVDNKIESLSEGQTFVKVNSVNNSATPIAAGVDATAIGVGAT
ASGADSIAMGNKASASADNAVAIGNHSVADRANTVSVGSAGSERQVTNVAAGTADTDAVNVSQLNQGLITAKQYTDGVVG
SLRRDTDGGVAAAIATANLPQAYIPGRGMTSVGVSSYRGQSAIAVGVSSVSESGRWVFKFSGSANTRSQVGIGAGVGYQW

Specific function: Unknown

COG id: COG5295

COG function: function code UW; Autotransporter adhesin

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 142833; Mature: 142833

Theoretical pI: Translated: 4.58; Mature: 4.58

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.1 %Cys     (Translated Protein)
1.1 %Met     (Translated Protein)
1.2 %Cys+Met (Translated Protein)
0.1 %Cys     (Mature Protein)
1.1 %Met     (Mature Protein)
1.2 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MQIHTALPMVRLGGIEGVDPLFLPKYKIGRSLQHAVMTSAASSKKGTQPRRSNNAMTAKR
CEEHHHCCEEEECCCCCCCCCCCCCHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCEEECC
SAKPHDRRQLHIVLLTVLAASTGYTGKVSAQVYVNSDSTENCVEILGDSSQTSFIHSASN
CCCCCCHHEEEEEEEEHHHHCCCCCCEEEEEEEECCCCHHHHHHHHCCCCCCEEEECCCC
DKCKPDFTQTEYSLFYDYRNLVLGGSLYVNEGKLGLVDISGATYSMRLGSIATMNGSAGI
CCCCCCCCCCCEEEEEEEHHEEECCEEEEECCCEEEEEECCCEEEEEECEEEEECCCCCC
DSIAIGSGQGSQTDGNTSGATVAQGLRSIAIGTTARSQSQDAISIGTGASTTGNFAIAIG
CEEEEECCCCCCCCCCCCCHHHHHHHHHEEEECCCCCCCCCEEEECCCCCCCCCEEEEEC
NGALTSIANGIALGASSSVTTRGGVALGQGSLAATASGITGYDPVTKSTSTLSTSIWRST
CCHHHHHHCCEEECCCCCCEECCCEEECCCCCEEEECCCCCCCCCCCCCHHHHHHHHHHH
LGAVSIGNITSSTSQTRQLTGLAAGRSDTDAVNVAQLKLLAESVGGGWNLTASGANSSNV
HCCEEECCCCCCCCHHHEEEEEECCCCCCCCHHHHHHHHHHHHCCCCEEEEECCCCCCCE
ALGESVDLKNSDGNLLITKATDSNDVTFNLATALKVDSLTTGNTAMTTDGVTVGKRVTLD
EECCEEECCCCCCCEEEEECCCCCCEEEEEEEEEEECCCCCCCEEEEECCEEECCEEEEC
STGLVIAEGPSVISSGINAAGQKIINVGTGTADTDAVNFGQLQAVSDTASKGWNLLASGA
CCCEEEECCCHHHHHCCCCCCCEEEEECCCCCCCCCCCCCCEEEECHHHHCCCEEEECCC
NSSNVAPGESVDLKNSDGNLLITKTTDSNDVTFNLATALEVDSLTTGNTAMTTDGVAVGS
CCCCCCCCCCEEEECCCCCEEEEEECCCCCEEEEEEEEEEECCCCCCCEEEEECCEEECC
NVKLGSTGLVITDGPSVTSSGISAGNQKITNVAAGTADTDAVNFSQLQAVSSTASKGWNL
CEEECCCCEEEECCCCCCCCCCCCCCCEEEEEECCCCCCCCCCHHHHHHHHHHHHCCCEE
LASGANSSNVAPGGSVDLKNSDGNLLITKTTDSNDVTFNLATALEVDSLTTGNTAMTTDG
EECCCCCCCCCCCCCEEEECCCCCEEEEEECCCCCEEEEEEEEEEECCCCCCCEEEEECC
VAVGSNVKLGSTGLVITDGPSVTSSGISAGNQKITNVAAGTADTDVVNFSQLQAVSSTAS
EEECCCEEECCCCEEEECCCCCCCCCCCCCCCEEEEEECCCCCCCEECHHHHHHHHHHHH
KGWNLLASGANSSNVAPGGSVDLKNSDGNLLITKTTDSNDVTFNLATALEVDSLTTGNTA
CCCEEEECCCCCCCCCCCCCEEEECCCCCEEEEEECCCCCEEEEEEEEEEECCCCCCCEE
MTTDGVAVGSNVKLGSTGLVITDGPSVTSSGISAGNQKITNVAAGTADTDVVNFSQLQAV
EEECCEEECCCEEECCCCEEEECCCCCCCCCCCCCCCEEEEEECCCCCCCEECHHHHHHH
SSTASKGWNLLASGANSSNVAPGGSVDLKNSDGNLLITKTTDSNDVTFNLATALEVDSLT
HHHHHCCCEEEECCCCCCCCCCCCCEEEECCCCCEEEEEECCCCCEEEEEEEEEEECCCC
TGNTAMTTDGVAVGSNVKLGSTGLVITDGPSVTSSGISAGNQKITNVAAGTADTDAVNFS
CCCEEEEECCEEECCCEEECCCCEEEECCCCCCCCCCCCCCCEEEEEECCCCCCCCCCHH
QLQAVSSTASKGWNLLASGANSSNVAPGESVDLKNTDGNIVISKESGSNDVLFNLSSSLK
HHHHHHHHHHCCCEEEECCCCCCCCCCCCCEEEECCCCCEEEEECCCCCCEEEEECCCCE
LDKLTVGDTVMTTNGVTVGSGVTLGSMGLVITDGPSVTSSGINAGSQKITNVAAGTADTD
EEEEEECCEEEEECCEEECCCCEECCCCEEEECCCCCCCCCCCCCCHHHHHEECCCCCCC
AVNLSQLNTAMASSGAKSVHYYSTYDGGTQGGNYNGDGATGTGSIAVGVGTLASAEGATA
CEEHHHHHHHHHCCCCCEEEEEEECCCCCCCCCCCCCCCCCCCEEEEEECCCCCCCCCCE
IGSGAAASGKGSTAIGRNAVASADGSVALGDGAKDGARGAESYTGKYSGVQNNTVGTVSV
ECCCCCCCCCCCCCCCCCCEECCCCCEEECCCCCCCCCCCHHCCCCCCCCCCCCEEEEEC
GDASKGETRTVSNVADAKEATDAVNLRQLDQVAQDANRYVDNKIESLSEGQTFVKVNSVN
CCCCCCCCEEHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCEEEEEECCC
NSATPIAAGVDATAIGVGATASGADSIAMGNKASASADNAVAIGNHSVADRANTVSVGSA
CCCCCEECCCCCEEEECCCCCCCCCCEECCCCCCCCCCCEEEECCCCCCCCCCEEEECCC
GSERQVTNVAAGTADTDAVNVSQLNQGLITAKQYTDGVVGSLRRDTDGGVAAAIATANLP
CCCCEEEEEECCCCCCCCEEHHHHCCCEEEEHHHCCCHHHHHCCCCCCCEEEEEEECCCC
QAYIPGRGMTSVGVSSYRGQSAIAVGVSSVSESGRWVFKFSGSANTRSQVGIGAGVGYQW
CEECCCCCCCCCCCHHCCCCCEEEEEEHHHCCCCCEEEEECCCCCCCCCCCCCCCCCCCC
>Mature Secondary Structure
MQIHTALPMVRLGGIEGVDPLFLPKYKIGRSLQHAVMTSAASSKKGTQPRRSNNAMTAKR
CEEHHHCCEEEECCCCCCCCCCCCCHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCEEECC
SAKPHDRRQLHIVLLTVLAASTGYTGKVSAQVYVNSDSTENCVEILGDSSQTSFIHSASN
CCCCCCHHEEEEEEEEHHHHCCCCCCEEEEEEEECCCCHHHHHHHHCCCCCCEEEECCCC
DKCKPDFTQTEYSLFYDYRNLVLGGSLYVNEGKLGLVDISGATYSMRLGSIATMNGSAGI
CCCCCCCCCCCEEEEEEEHHEEECCEEEEECCCEEEEEECCCEEEEEECEEEEECCCCCC
DSIAIGSGQGSQTDGNTSGATVAQGLRSIAIGTTARSQSQDAISIGTGASTTGNFAIAIG
CEEEEECCCCCCCCCCCCCHHHHHHHHHEEEECCCCCCCCCEEEECCCCCCCCCEEEEEC
NGALTSIANGIALGASSSVTTRGGVALGQGSLAATASGITGYDPVTKSTSTLSTSIWRST
CCHHHHHHCCEEECCCCCCEECCCEEECCCCCEEEECCCCCCCCCCCCCHHHHHHHHHHH
LGAVSIGNITSSTSQTRQLTGLAAGRSDTDAVNVAQLKLLAESVGGGWNLTASGANSSNV
HCCEEECCCCCCCCHHHEEEEEECCCCCCCCHHHHHHHHHHHHCCCCEEEEECCCCCCCE
ALGESVDLKNSDGNLLITKATDSNDVTFNLATALKVDSLTTGNTAMTTDGVTVGKRVTLD
EECCEEECCCCCCCEEEEECCCCCCEEEEEEEEEEECCCCCCCEEEEECCEEECCEEEEC
STGLVIAEGPSVISSGINAAGQKIINVGTGTADTDAVNFGQLQAVSDTASKGWNLLASGA
CCCEEEECCCHHHHHCCCCCCCEEEEECCCCCCCCCCCCCCEEEECHHHHCCCEEEECCC
NSSNVAPGESVDLKNSDGNLLITKTTDSNDVTFNLATALEVDSLTTGNTAMTTDGVAVGS
CCCCCCCCCCEEEECCCCCEEEEEECCCCCEEEEEEEEEEECCCCCCCEEEEECCEEECC
NVKLGSTGLVITDGPSVTSSGISAGNQKITNVAAGTADTDAVNFSQLQAVSSTASKGWNL
CEEECCCCEEEECCCCCCCCCCCCCCCEEEEEECCCCCCCCCCHHHHHHHHHHHHCCCEE
LASGANSSNVAPGGSVDLKNSDGNLLITKTTDSNDVTFNLATALEVDSLTTGNTAMTTDG
EECCCCCCCCCCCCCEEEECCCCCEEEEEECCCCCEEEEEEEEEEECCCCCCCEEEEECC
VAVGSNVKLGSTGLVITDGPSVTSSGISAGNQKITNVAAGTADTDVVNFSQLQAVSSTAS
EEECCCEEECCCCEEEECCCCCCCCCCCCCCCEEEEEECCCCCCCEECHHHHHHHHHHHH
KGWNLLASGANSSNVAPGGSVDLKNSDGNLLITKTTDSNDVTFNLATALEVDSLTTGNTA
CCCEEEECCCCCCCCCCCCCEEEECCCCCEEEEEECCCCCEEEEEEEEEEECCCCCCCEE
MTTDGVAVGSNVKLGSTGLVITDGPSVTSSGISAGNQKITNVAAGTADTDVVNFSQLQAV
EEECCEEECCCEEECCCCEEEECCCCCCCCCCCCCCCEEEEEECCCCCCCEECHHHHHHH
SSTASKGWNLLASGANSSNVAPGGSVDLKNSDGNLLITKTTDSNDVTFNLATALEVDSLT
HHHHHCCCEEEECCCCCCCCCCCCCEEEECCCCCEEEEEECCCCCEEEEEEEEEEECCCC
TGNTAMTTDGVAVGSNVKLGSTGLVITDGPSVTSSGISAGNQKITNVAAGTADTDAVNFS
CCCEEEEECCEEECCCEEECCCCEEEECCCCCCCCCCCCCCCEEEEEECCCCCCCCCCHH
QLQAVSSTASKGWNLLASGANSSNVAPGESVDLKNTDGNIVISKESGSNDVLFNLSSSLK
HHHHHHHHHHCCCEEEECCCCCCCCCCCCCEEEECCCCCEEEEECCCCCCEEEEECCCCE
LDKLTVGDTVMTTNGVTVGSGVTLGSMGLVITDGPSVTSSGINAGSQKITNVAAGTADTD
EEEEEECCEEEEECCEEECCCCEECCCCEEEECCCCCCCCCCCCCCHHHHHEECCCCCCC
AVNLSQLNTAMASSGAKSVHYYSTYDGGTQGGNYNGDGATGTGSIAVGVGTLASAEGATA
CEEHHHHHHHHHCCCCCEEEEEEECCCCCCCCCCCCCCCCCCCEEEEEECCCCCCCCCCE
IGSGAAASGKGSTAIGRNAVASADGSVALGDGAKDGARGAESYTGKYSGVQNNTVGTVSV
ECCCCCCCCCCCCCCCCCCEECCCCCEEECCCCCCCCCCCHHCCCCCCCCCCCCEEEEEC
GDASKGETRTVSNVADAKEATDAVNLRQLDQVAQDANRYVDNKIESLSEGQTFVKVNSVN
CCCCCCCCEEHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCEEEEEECCC
NSATPIAAGVDATAIGVGATASGADSIAMGNKASASADNAVAIGNHSVADRANTVSVGSA
CCCCCEECCCCCEEEECCCCCCCCCCEECCCCCCCCCCCEEEECCCCCCCCCCEEEECCC
GSERQVTNVAAGTADTDAVNVSQLNQGLITAKQYTDGVVGSLRRDTDGGVAAAIATANLP
CCCCEEEEEECCCCCCCCEEHHHHCCCEEEEHHHCCCHHHHHCCCCCCCEEEEEEECCCC
QAYIPGRGMTSVGVSSYRGQSAIAVGVSSVSESGRWVFKFSGSANTRSQVGIGAGVGYQW
CEECCCCCCCCCCCHHCCCCCEEEEEEHHHCCCCCEEEEECCCCCCCCCCCCCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA