Definition Xylella fastidiosa M23 chromosome, complete genome.
Accession NC_010577
Length 2,535,690

Click here to switch to the map view.

The map label for this gene is yadA [H]

Identifier: 182681333

GI number: 182681333

Start: 920877

End: 928391

Strand: Direct

Name: yadA [H]

Synonym: XfasM23_0780

Alternate gene names: 182681333

Gene position: 920877-928391 (Clockwise)

Preceding gene: 182681332

Following gene: 182681334

Centisome position: 36.32

GC content: 52.63

Gene sequence:

>7515_bases
ATGGTATTTATAGCTCCACATAGTAGTAAACAGCATGGGAAGGAACCGCTGCATACTATTTTATTTGCTGCGTTGTCGCT
GTCGCTTCCATATGCTGAAGAGGCTAGAGCCCAACTTTATATCAATGATGGTATTGATGGGCAATGTCAGAGGATCGTTG
ATTTTGGAAACACGACCATTGAGTCGAAAACTTCCCCCCTATGCAATGAAGATCCGTGGACTGTGACAGGTTACGCTCGT
TTCTTCGGTGCCCCTGGAGCCACTGCTGACCAGGGGAACGCATCAAGAAGTCTTGCGCTGGGTGGGGTTTTATATGTCAA
TTCGGGTCAATTCGGTGTTAATGACGTTTTAAATAAAACGTATTCGATCCGTATGGGCAGTGTGATAACCATGAACACTA
TGGCGGGAACCAACGCAATTGCGATTGGTTCGGCGCAGAGTAGTGCGGCTGATGCACTGAAAGCGAGCTTGGCAACCAAA
GCAACTGGTGCACGCGCAATTGCAATTGGTGCAAAGGCGTCTGCCGATGGTACCGATACAGTGGCATTAGGGTCTGGAGC
AACGGCGGGTACGGGTGCTTCTTCGGTTGCTATTGGTCTTAATGCCTCGGCAGTCAATGGTGCCGTTGCGGTTGGTGGGG
GTGCGCTGGTTACAGTACCAGATGGAGCGGTGGCATTGGGATTGAACTCGGTTGCTTCTACTGGCAAGGGCCTCTCAGGG
TACGACCCAAAAACAAAAACGATTTCCACTGACGCTTCAGCGGCCTGGAAAAGCACACTGGCAGCAGTCAGTATCGGCGA
TGTATCTAGTAGCAATTTTAAGACGCGTCAGCTCTCAGGTTTGGCGGCAGGCACATCAAATACCGATGCAGTGAATGTTG
CTCAGCTTAAGGTCGTTGACGAGATTGCCAGTAAAGGCTGGAACCTTACGGCGTCCGGGGCCAACAGTGGCAACGTAGGT
CCAGGAAGTTCAGTGGACCTGAAAAACACCGACAAAAATCTGACGATTACAAAAGCGATCGGAAGTAATGATGTGGAATT
CAATTTGAACAAGGATGTCAAAGTTACAACATTGGCTGTTGGTGATGCTTTGCTGAATACCGATGGGATCGCGTTAGGCA
CTGATGTTGCATTGGGTACGACGGGTTTGACGATTACCAATGGTCCTGCGGTGACTGCATCGGGTATTGATGCGGGCAGC
AAGGTGATTAGCCATGTTGCGGCGGGTGAGGTGTCGGAGACGTCGACGGATGCGGTGAACGGCTCGCAGTTGAATGCAGT
GCAAGTGCAAGCCAGTCAGCCGGTAACGTTTAGTGGAAACGAAGGGTCGGTGAAACGTAGCCTAGGTCAGGCGGTGGTGA
TCAGTGGCGAGAGCAGTACTGCGGGGACGTATTCAGGTGGGAATTTAAAGAGTGTGGTGGATGAAGCAGCTGGTGCGATT
CATTTACAACTGGCGGATTCTCCGAAGTTTGGCAATGTGGTGATCAACAACGGCGGCAAGATCAGCGGGTTGACGGCAGG
GACAGAGGATACGGATGCGGTCAACTTGAGTCAGTTGAAGTCGATCAGCGATACGGTGGATAAGGGGTGGACGCTGACGG
CGTCAGGTGCCAATGGGAGCAAAGTGGTCTCTGGCGGTGCGGTGGACCTGAAGAACACAGATGGGAATCTGACGATCAGC
AAATCCGGTGATAGCAATGATGTGGTGTTTAACCTGTCCAAGGATTTCAAAGTGGATGGGATGACCTCAGGCACCACGGT
CGTGAATAACGATGGCGTGAAGGTAGGCACTGATGTTGCGTTAGGTACGACGGGTTTGACGATTGCCAATGGTCCTGCGG
TGACTGCATCGGGTATTGATGCGGGCAGCAAGGTGATTAGCCATGTTGCGGCCGGTGAGGTGTCAGAGACGTCGACGGAT
GCGGTGAACGGCTCGCAGTTGAATGCAGTGCAAGCGCAAGCCAGTCAGCCGGTAACGTTTAGTGGAAACGAAGGCTCGGT
GAAACGGACCCTGGGTCAGGCGGTGGTGATTAGTGGTGAAAGTAGTACTGCGGGGACGTATTCAGGTGGGAATTTAAAGA
GTGTGGTGGATGAAGCAGCTGGTGCGATTCATTTACAACTGGCGGATTCTCCGAAGTTTGGCAATGTGTTGATCAACAAC
GGCGGCAAGATCAGCGGGTTGACAGCAGGGACAGAGGATACGGATGCGGTCAACTTGAGTCAGTTGAAGTCGATCAGCGA
TACGGTGGATAAGGGGTGGACGCTGACAGCGTCAGGTGCCAATGGGAGCAAAGTGGTCTCTGGCGGTGCGGTGGACCTGA
AGAACACAGATGGGAATCTGACGATCAGCAAATCCGGTGATAGCAATGATGTGGTGTTTAACCTGTCCAAGGATTTCAAA
GTGGATGGGATGACCTCAGGCACCACGGTCGTGAATAACGATGGCGTGAAGGTCGGTAGCGATGTTGCGTTAGGTACGAC
GGGTTTGACGATTACCAATGGTCCTGCGGTGACTGCATCGGGTATTGATGCAGGCAGCAAGGTGATTAGCCATGTGGCGG
CCGGTGAGGTGTCAGAGACGTCGACGGATGCGGTGAACGGCTCGCAGTTGAATGCAGTGCAAGCGCAAGCCAGTCAGCCG
GTAACGTTTAGTGGAAACGAAGGCTCGGTGAAACGGACCCTGGGTCAGGCGGTGGTGATTAGTGGTGAAAGCAGTACTGC
GGGGACGTATTCAGGTGGGAATTTAAAGAGTGTGGTGGATGAAGCAGCTGGTGCGATTCATTTACAACTGGCGGATTCTC
CGAAGTTTGGCAATGTGTTGATCAACAACGGCGGCAAGATTAGCGGGCTTACGGCAGGGACAGAGGATACGGATGCGGTC
AACTTGAGTCAGTTGAAGTCGATCAGCGATACGGTGGATAAGGGGTGGACGCTGACAGCGTCAGGTGCCAATGGGAGCAA
AGTGGTCTCTGGCGGTGCGGTGGACCTGAAGAACACAGATGGGAATCTGACGATCAGCAAATCCGGTGATAGCAATGATG
TGGTGTTTAACCTGTCCAAGGATTTCAAAGTGGATGGGATGACCTCAGGCACCACGGTCGTGAATAACGATGGCGTGAAG
GTAGGCACTGATGTTGCGTTAGGTACGACGGGTTTGACGATTGCCAATGGTCCTGCGGTGACTGCATCGGGTATTGATGC
GGGCAGCAAGGTGATTAGCCATGTTGCGGCCGGTGAGGTGTCGGAGACGTCGACGGATGCGGTGAACGGCTCGCAGTTGA
ATGCAGTGCAAGCGCAAGCCAGTCAGCCGGTAACGTTTAGTGGAAACGAAGGCTCGGTGAAACGGACCCTGGGTCAGGCG
GTGGTGATTAGTGGTGAAAGCAGTACTGCGGGGACGTATTCAGGTGGGAATTTAAAGAGTGTGGTGGATGAAGCAGCTGG
TGCGATTCATTTACAACTGGCGGATTCTCCGAAGTTTGGCAATGTGGTGATCAACAACGGCGGCAAGATTAGCGGGCTTA
CGGCAGGGACAGAGGATACGGATGCGGTCAACTTGAGTCAGTTGAAGTCGATCAGCGATACGGTGGATAAGGGGTGGACG
CTGACAGCGTCAGGTGCCAATGGGAGCAAAGTGGTCTCTGGCGGTGCGGTGGACCTGAAGAACACAGATGGGAATCTGAC
GATCAGCAAATCCGGTGATAGCAATGATGTGGTGTTTAACCTGTCCAAGGATTTCAAAGTGGATGGGATGACCTCAGGCA
CCACGGTCGTGAATAACGATGGCGTGAAGGTAGGCACTGATGTTGCGTTAGGTACGACGGGTTTGACGATTGCCAATGGT
CCTGCGGTGACTGCATCGGGTATTGATGCGGGCAGCAAGGTGATTAGCCATGTTGCGGCCGGTGAGGTGTCGGAGACGTC
GACGGATGCGGTGAACGGCTCGCAGTTGAATGCAGTGCAAGCGCAAGCCAGTCAGCCGGTAACGTTTAGTGGAAACGAAG
GCTCGGTGAAACGGACCCTGGGTCAGGCGGTGGTGATTAGTGGTGAAAGCAGTACTGCGGGGACGTATTCAGGTGGGAAT
TTGAAGAGTGTGGTGGATGAAGCAGCTGGTGCGATTCATTTACAACTGGCGGATTCTCCGAAGTTTGGCAATGTGTTGAT
CAACAACGGCGGCAAGATTAGCGGGTTGACGGCAGGGACAGAGGATACGGATGCGGTCAACTTGAGTCAGTTGAAGTCGA
TCAGCGATACGGTGGATAAGGGGTGGACGCTGACAGCGTCAGGTGCCAATGGGAGCAAAGTGGTCTCTGGCGGTGCGGTG
GACCTGAAGAACACAGATGGGAATCTGACGATCAGCAAATCCGGTGATAGCAATGATGTGGTGTTTAACCTGTCCAAGGA
TTTCAAAGTGGATGGGATGACCTCAGGCACCACGGTCGTGAATAACGATGGCGTGAAGGTCGGTAGCGATGTTGCGTTAG
GTACGACGGGTTTGACGATTACCAATGGTCCTGCGGTGACTGCATCGGGTATTGATGCGGGCAGCAAGGTGATTAGCCAT
GTGGCGGCCGGTGAGGTGTCAGAGACGTCGACGGATGCGGTGAACGGCTCGCAGTTGAATGCAGTGCAAGCGCAAGCCAG
TCAGCCGGTAACGTTTAGTGGAAACGAAGGCTCGGTGAAACGGACCCTAGGTCAGGCGGTGGTGATCAGTGGCGAGAGCA
GTACTGCGGGGACGTATTCAGGTGGGAATTTGAAGAGTGTGGTGGATGAAGCAGCTGGTGCGATTCATTTACAACTGGCG
GATTCTCCGAAGTTTGGCAATGTGTTGATCAACAACGGCGGCAAGATTAGCGGGCTGACGGCAGGGACAGAGGATACGGA
TGCGGTCAACTTGAGTCAGTTGAAGTCGATCAGCGATACGGTGGATAAGGGGTGGACGCTGACAGCGTCAGGTGCCAATG
GGAGCAAAGTGGTCTCTGGCGGTGCGGTGGACCTGAAGAACACAGATGGGAATCTGACGATCAGCAAATCCGGTGATAGC
AATGATGTGGTGTTTAACCTGTCCAAGGATTTCAAAGTGGATGGGATGACCTCAGGCACCACGGTCGTGAATAACGATGG
CGTGAAGGTCGGTAGCGATGTTGCGTTAGGTACGACGGGTTTGACGATTACCAATGGTCCTGCGGTGACTGCATCGGGTA
TTGATGCAGGCAGCAAGGTGATTAGCCATGTGGCGGCCGGTGAGGTGTCAGAGACGTCGACGGATGCGGTGAACGGCTCG
CAGTTGAATGCAGTGCAAGCGCAAGCCAGTCAGCCGGTAACGTTTAGTGGAAACGAAGGCTCGGTGAAACGGACCCTGGG
TCAGGCGGTGGTGATTAGTGGTGAAAGCAGTACTGCGGGGACGTATTCAGGTGGGAATTTAAAGAGTGTGGTGGATGAAG
CAGCTGGTGCGATTCATTTACAACTGGCGGATTCTCCGAAGTTTGGCAATGTGTTGATCAACAACGGCGGCAAGATTAGC
GGGCTTACGGCAGGGACAGAGGATACGGATGCGGTCAACTTGAGTCAGTTGAAGTCGATCAGCGATACGGTGGATAAGGG
GTGGACGCTGACAGCGTCAGGTGCCAATGGGAGCAAAGTGGTCTCTGGTGGTGCGGTGGACCTGAAGAACACAGATGGGA
ATCTGACGATCAGCAAATCCGGTGATAGCAATGATGTGGTGTTTAACTTGTCTGAGGATCTTAAGGAGAAAAGTGTAACG
GTGGGTAACACTCAGCTGGACAAGGATGGGGTGAAGGTGAGCAGTGATGTTTTGCTGAATTCTAAGTCGTTAGTGATTAT
GAGCCATTCATCCACTTCATCTGTCAAGACTTTGGAAGATGGAGAAAGTGTTGTTAACAGGACGGTTGTGAATGGCGATG
GTGTGAATATTGATGATGTTGTTGTTGTTAATGATCTTGGGTTATCAATTGTCGGTGGGGCGTCGGTTACGTTGAGTGGT
ATCAATGCTGGCAGCCATAAGATCACTAATGTGACGGCAGGGACGGAGGATACGGATGCGGTCAACTTGAGTCAGTTGAA
GTCGGTCAGCGAGGCGGTTGATAAGGGGTGGACGTTGACGGCGTCGGGTGCCAATGGGAGCAGTGTGGTGTCTGGCGGTA
CGGTGGATCTGAAGAATACGGATGGGAATCTGACGATCAGTAAATCCAGCGATAGCAATGATGTGGTGTTTAACCTGTCC
AAGGATTTCAAAGTGGATGGGGTGACTGCAGGCAATACTGTGGTGAACACCGATGGTGTGAAGGTGGGTAGCGATGTTTC
GTTGGGTGCAATGGGATTATTCATTGCTAATGGACCTTCGGTGACGGCTTCAGGGTTCAATGCGGGTGACAAAGTCATCA
GCCATGTTGCAGTGGGTATGGCAGATACAGATGCGGTTAACGTCAGTCAATTGAAGCAGGCAGTACAGAATGTGAGTGTC
AAAGCGACTCGCTATTACAGTACGAATGATGGTGGCACCCAGGGAGGTAACTATGATGGTGATGGTGCGACAGGCAGTAA
GGCTGTCGCGGCCGGTGTTGGTACGCAGGCATCTGGTGAAGGGGCGACAGCGGTGGGATCTGGTGCTGCTTCGAGTGGCA
AAGGTTCTACGGCGATTGGCCGTAATGCGATTGCTAGTGCTGATGGCAGTGTGGCTTTGGGTGATGGTGCAAAGGATGGT
GGGCGTGGTGCAGAAAGTTACACTGGGAAATATTCAGGTGTACAGAACAATACGATGGGAACTGTTTCGGTAGGTGATGC
TGCTAAGGGGGAAACCCGTTCGATCAGTAATGTGGCTGATGCTAAGGAGGAGACGGATGCGGTGAATTTGCGCCAGCTTG
ATGCTGTGGCCCAGAAGTCAAATCTTCAAACGGATGATATGAGGCATGAGATCAATAATATAGAGGATGTTTTTAAGGTC
ACTAAAGGTGACAGTACTCCAAGTGTTAAAGGGATGGGGGTCAATGCGATGGCCATTGGTACCAATGCTGCAGTTTCAGG
TACAGATAGTGTTGCGTTGGGTAAGAATACGAATGTGTCTGCTGATAATGCGGTTGCTATTGGTAATGATTCAGTAGCTG
ACCGCGCAAACAGTGTTTCGGTGGGATCTGCGGGTTCTCAGAGGCAGGTGACGAATGTGGCTGCAGGCACTGCTGATACG
GATGCGGTCAATGTAAGTCAACTCAATCAAGGCTTGATCACTGCCAAGCAGTACACGGATGGGATGGTAGGGAATCTCCG
TAGGGAGACTAACGGGGGTGTGGCCGCAGCGATTGCGACGGCAAATCTCCCGCAGGCTTATGTTCAGGGACGAGGGATGA
CCTCTGTTGGAGTCAGTAGTTATCAGGGTCAGTCGGCGATTGCGGTGGGTGTTTCAGCGGTTTCTGACAGTGGGCATTGG
GTGTTCAAGTTCAGTGGTAGTGCGAATACCCGTAGTCACGTGGGTGTAGGTGCAGGTGTGGGTTATCAGTGGTGA

Upstream 100 bases:

>100_bases
CAGATAAGATGAAGAGAACTTTTTCATCAAGTCCAAAATATATAACCGATCAGTTATTTCTTGATTTAGGCAATCTGGGT
CGAGTACTGGGGGGTGGATC

Downstream 100 bases:

>100_bases
GTGTAGTTTGTGGGGCGGGGAGTGGTTCTCCGCCCTACCTCAGTGTGCTGTGTGTAATGCTTTGGTTTGGCAACTGGATT
TTCTAGATGTCCACGCGATC

Product: hypothetical protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 2504; Mature: 2504

Protein sequence:

>2504_residues
MVFIAPHSSKQHGKEPLHTILFAALSLSLPYAEEARAQLYINDGIDGQCQRIVDFGNTTIESKTSPLCNEDPWTVTGYAR
FFGAPGATADQGNASRSLALGGVLYVNSGQFGVNDVLNKTYSIRMGSVITMNTMAGTNAIAIGSAQSSAADALKASLATK
ATGARAIAIGAKASADGTDTVALGSGATAGTGASSVAIGLNASAVNGAVAVGGGALVTVPDGAVALGLNSVASTGKGLSG
YDPKTKTISTDASAAWKSTLAAVSIGDVSSSNFKTRQLSGLAAGTSNTDAVNVAQLKVVDEIASKGWNLTASGANSGNVG
PGSSVDLKNTDKNLTITKAIGSNDVEFNLNKDVKVTTLAVGDALLNTDGIALGTDVALGTTGLTITNGPAVTASGIDAGS
KVISHVAAGEVSETSTDAVNGSQLNAVQVQASQPVTFSGNEGSVKRSLGQAVVISGESSTAGTYSGGNLKSVVDEAAGAI
HLQLADSPKFGNVVINNGGKISGLTAGTEDTDAVNLSQLKSISDTVDKGWTLTASGANGSKVVSGGAVDLKNTDGNLTIS
KSGDSNDVVFNLSKDFKVDGMTSGTTVVNNDGVKVGTDVALGTTGLTIANGPAVTASGIDAGSKVISHVAAGEVSETSTD
AVNGSQLNAVQAQASQPVTFSGNEGSVKRTLGQAVVISGESSTAGTYSGGNLKSVVDEAAGAIHLQLADSPKFGNVLINN
GGKISGLTAGTEDTDAVNLSQLKSISDTVDKGWTLTASGANGSKVVSGGAVDLKNTDGNLTISKSGDSNDVVFNLSKDFK
VDGMTSGTTVVNNDGVKVGSDVALGTTGLTITNGPAVTASGIDAGSKVISHVAAGEVSETSTDAVNGSQLNAVQAQASQP
VTFSGNEGSVKRTLGQAVVISGESSTAGTYSGGNLKSVVDEAAGAIHLQLADSPKFGNVLINNGGKISGLTAGTEDTDAV
NLSQLKSISDTVDKGWTLTASGANGSKVVSGGAVDLKNTDGNLTISKSGDSNDVVFNLSKDFKVDGMTSGTTVVNNDGVK
VGTDVALGTTGLTIANGPAVTASGIDAGSKVISHVAAGEVSETSTDAVNGSQLNAVQAQASQPVTFSGNEGSVKRTLGQA
VVISGESSTAGTYSGGNLKSVVDEAAGAIHLQLADSPKFGNVVINNGGKISGLTAGTEDTDAVNLSQLKSISDTVDKGWT
LTASGANGSKVVSGGAVDLKNTDGNLTISKSGDSNDVVFNLSKDFKVDGMTSGTTVVNNDGVKVGTDVALGTTGLTIANG
PAVTASGIDAGSKVISHVAAGEVSETSTDAVNGSQLNAVQAQASQPVTFSGNEGSVKRTLGQAVVISGESSTAGTYSGGN
LKSVVDEAAGAIHLQLADSPKFGNVLINNGGKISGLTAGTEDTDAVNLSQLKSISDTVDKGWTLTASGANGSKVVSGGAV
DLKNTDGNLTISKSGDSNDVVFNLSKDFKVDGMTSGTTVVNNDGVKVGSDVALGTTGLTITNGPAVTASGIDAGSKVISH
VAAGEVSETSTDAVNGSQLNAVQAQASQPVTFSGNEGSVKRTLGQAVVISGESSTAGTYSGGNLKSVVDEAAGAIHLQLA
DSPKFGNVLINNGGKISGLTAGTEDTDAVNLSQLKSISDTVDKGWTLTASGANGSKVVSGGAVDLKNTDGNLTISKSGDS
NDVVFNLSKDFKVDGMTSGTTVVNNDGVKVGSDVALGTTGLTITNGPAVTASGIDAGSKVISHVAAGEVSETSTDAVNGS
QLNAVQAQASQPVTFSGNEGSVKRTLGQAVVISGESSTAGTYSGGNLKSVVDEAAGAIHLQLADSPKFGNVLINNGGKIS
GLTAGTEDTDAVNLSQLKSISDTVDKGWTLTASGANGSKVVSGGAVDLKNTDGNLTISKSGDSNDVVFNLSEDLKEKSVT
VGNTQLDKDGVKVSSDVLLNSKSLVIMSHSSTSSVKTLEDGESVVNRTVVNGDGVNIDDVVVVNDLGLSIVGGASVTLSG
INAGSHKITNVTAGTEDTDAVNLSQLKSVSEAVDKGWTLTASGANGSSVVSGGTVDLKNTDGNLTISKSSDSNDVVFNLS
KDFKVDGVTAGNTVVNTDGVKVGSDVSLGAMGLFIANGPSVTASGFNAGDKVISHVAVGMADTDAVNVSQLKQAVQNVSV
KATRYYSTNDGGTQGGNYDGDGATGSKAVAAGVGTQASGEGATAVGSGAASSGKGSTAIGRNAIASADGSVALGDGAKDG
GRGAESYTGKYSGVQNNTMGTVSVGDAAKGETRSISNVADAKEETDAVNLRQLDAVAQKSNLQTDDMRHEINNIEDVFKV
TKGDSTPSVKGMGVNAMAIGTNAAVSGTDSVALGKNTNVSADNAVAIGNDSVADRANSVSVGSAGSQRQVTNVAAGTADT
DAVNVSQLNQGLITAKQYTDGMVGNLRRETNGGVAAAIATANLPQAYVQGRGMTSVGVSSYQGQSAIAVGVSAVSDSGHW
VFKFSGSANTRSHVGVGAGVGYQW

Sequences:

>Translated_2504_residues
MVFIAPHSSKQHGKEPLHTILFAALSLSLPYAEEARAQLYINDGIDGQCQRIVDFGNTTIESKTSPLCNEDPWTVTGYAR
FFGAPGATADQGNASRSLALGGVLYVNSGQFGVNDVLNKTYSIRMGSVITMNTMAGTNAIAIGSAQSSAADALKASLATK
ATGARAIAIGAKASADGTDTVALGSGATAGTGASSVAIGLNASAVNGAVAVGGGALVTVPDGAVALGLNSVASTGKGLSG
YDPKTKTISTDASAAWKSTLAAVSIGDVSSSNFKTRQLSGLAAGTSNTDAVNVAQLKVVDEIASKGWNLTASGANSGNVG
PGSSVDLKNTDKNLTITKAIGSNDVEFNLNKDVKVTTLAVGDALLNTDGIALGTDVALGTTGLTITNGPAVTASGIDAGS
KVISHVAAGEVSETSTDAVNGSQLNAVQVQASQPVTFSGNEGSVKRSLGQAVVISGESSTAGTYSGGNLKSVVDEAAGAI
HLQLADSPKFGNVVINNGGKISGLTAGTEDTDAVNLSQLKSISDTVDKGWTLTASGANGSKVVSGGAVDLKNTDGNLTIS
KSGDSNDVVFNLSKDFKVDGMTSGTTVVNNDGVKVGTDVALGTTGLTIANGPAVTASGIDAGSKVISHVAAGEVSETSTD
AVNGSQLNAVQAQASQPVTFSGNEGSVKRTLGQAVVISGESSTAGTYSGGNLKSVVDEAAGAIHLQLADSPKFGNVLINN
GGKISGLTAGTEDTDAVNLSQLKSISDTVDKGWTLTASGANGSKVVSGGAVDLKNTDGNLTISKSGDSNDVVFNLSKDFK
VDGMTSGTTVVNNDGVKVGSDVALGTTGLTITNGPAVTASGIDAGSKVISHVAAGEVSETSTDAVNGSQLNAVQAQASQP
VTFSGNEGSVKRTLGQAVVISGESSTAGTYSGGNLKSVVDEAAGAIHLQLADSPKFGNVLINNGGKISGLTAGTEDTDAV
NLSQLKSISDTVDKGWTLTASGANGSKVVSGGAVDLKNTDGNLTISKSGDSNDVVFNLSKDFKVDGMTSGTTVVNNDGVK
VGTDVALGTTGLTIANGPAVTASGIDAGSKVISHVAAGEVSETSTDAVNGSQLNAVQAQASQPVTFSGNEGSVKRTLGQA
VVISGESSTAGTYSGGNLKSVVDEAAGAIHLQLADSPKFGNVVINNGGKISGLTAGTEDTDAVNLSQLKSISDTVDKGWT
LTASGANGSKVVSGGAVDLKNTDGNLTISKSGDSNDVVFNLSKDFKVDGMTSGTTVVNNDGVKVGTDVALGTTGLTIANG
PAVTASGIDAGSKVISHVAAGEVSETSTDAVNGSQLNAVQAQASQPVTFSGNEGSVKRTLGQAVVISGESSTAGTYSGGN
LKSVVDEAAGAIHLQLADSPKFGNVLINNGGKISGLTAGTEDTDAVNLSQLKSISDTVDKGWTLTASGANGSKVVSGGAV
DLKNTDGNLTISKSGDSNDVVFNLSKDFKVDGMTSGTTVVNNDGVKVGSDVALGTTGLTITNGPAVTASGIDAGSKVISH
VAAGEVSETSTDAVNGSQLNAVQAQASQPVTFSGNEGSVKRTLGQAVVISGESSTAGTYSGGNLKSVVDEAAGAIHLQLA
DSPKFGNVLINNGGKISGLTAGTEDTDAVNLSQLKSISDTVDKGWTLTASGANGSKVVSGGAVDLKNTDGNLTISKSGDS
NDVVFNLSKDFKVDGMTSGTTVVNNDGVKVGSDVALGTTGLTITNGPAVTASGIDAGSKVISHVAAGEVSETSTDAVNGS
QLNAVQAQASQPVTFSGNEGSVKRTLGQAVVISGESSTAGTYSGGNLKSVVDEAAGAIHLQLADSPKFGNVLINNGGKIS
GLTAGTEDTDAVNLSQLKSISDTVDKGWTLTASGANGSKVVSGGAVDLKNTDGNLTISKSGDSNDVVFNLSEDLKEKSVT
VGNTQLDKDGVKVSSDVLLNSKSLVIMSHSSTSSVKTLEDGESVVNRTVVNGDGVNIDDVVVVNDLGLSIVGGASVTLSG
INAGSHKITNVTAGTEDTDAVNLSQLKSVSEAVDKGWTLTASGANGSSVVSGGTVDLKNTDGNLTISKSSDSNDVVFNLS
KDFKVDGVTAGNTVVNTDGVKVGSDVSLGAMGLFIANGPSVTASGFNAGDKVISHVAVGMADTDAVNVSQLKQAVQNVSV
KATRYYSTNDGGTQGGNYDGDGATGSKAVAAGVGTQASGEGATAVGSGAASSGKGSTAIGRNAIASADGSVALGDGAKDG
GRGAESYTGKYSGVQNNTMGTVSVGDAAKGETRSISNVADAKEETDAVNLRQLDAVAQKSNLQTDDMRHEINNIEDVFKV
TKGDSTPSVKGMGVNAMAIGTNAAVSGTDSVALGKNTNVSADNAVAIGNDSVADRANSVSVGSAGSQRQVTNVAAGTADT
DAVNVSQLNQGLITAKQYTDGMVGNLRRETNGGVAAAIATANLPQAYVQGRGMTSVGVSSYQGQSAIAVGVSAVSDSGHW
VFKFSGSANTRSHVGVGAGVGYQW
>Mature_2504_residues
MVFIAPHSSKQHGKEPLHTILFAALSLSLPYAEEARAQLYINDGIDGQCQRIVDFGNTTIESKTSPLCNEDPWTVTGYAR
FFGAPGATADQGNASRSLALGGVLYVNSGQFGVNDVLNKTYSIRMGSVITMNTMAGTNAIAIGSAQSSAADALKASLATK
ATGARAIAIGAKASADGTDTVALGSGATAGTGASSVAIGLNASAVNGAVAVGGGALVTVPDGAVALGLNSVASTGKGLSG
YDPKTKTISTDASAAWKSTLAAVSIGDVSSSNFKTRQLSGLAAGTSNTDAVNVAQLKVVDEIASKGWNLTASGANSGNVG
PGSSVDLKNTDKNLTITKAIGSNDVEFNLNKDVKVTTLAVGDALLNTDGIALGTDVALGTTGLTITNGPAVTASGIDAGS
KVISHVAAGEVSETSTDAVNGSQLNAVQVQASQPVTFSGNEGSVKRSLGQAVVISGESSTAGTYSGGNLKSVVDEAAGAI
HLQLADSPKFGNVVINNGGKISGLTAGTEDTDAVNLSQLKSISDTVDKGWTLTASGANGSKVVSGGAVDLKNTDGNLTIS
KSGDSNDVVFNLSKDFKVDGMTSGTTVVNNDGVKVGTDVALGTTGLTIANGPAVTASGIDAGSKVISHVAAGEVSETSTD
AVNGSQLNAVQAQASQPVTFSGNEGSVKRTLGQAVVISGESSTAGTYSGGNLKSVVDEAAGAIHLQLADSPKFGNVLINN
GGKISGLTAGTEDTDAVNLSQLKSISDTVDKGWTLTASGANGSKVVSGGAVDLKNTDGNLTISKSGDSNDVVFNLSKDFK
VDGMTSGTTVVNNDGVKVGSDVALGTTGLTITNGPAVTASGIDAGSKVISHVAAGEVSETSTDAVNGSQLNAVQAQASQP
VTFSGNEGSVKRTLGQAVVISGESSTAGTYSGGNLKSVVDEAAGAIHLQLADSPKFGNVLINNGGKISGLTAGTEDTDAV
NLSQLKSISDTVDKGWTLTASGANGSKVVSGGAVDLKNTDGNLTISKSGDSNDVVFNLSKDFKVDGMTSGTTVVNNDGVK
VGTDVALGTTGLTIANGPAVTASGIDAGSKVISHVAAGEVSETSTDAVNGSQLNAVQAQASQPVTFSGNEGSVKRTLGQA
VVISGESSTAGTYSGGNLKSVVDEAAGAIHLQLADSPKFGNVVINNGGKISGLTAGTEDTDAVNLSQLKSISDTVDKGWT
LTASGANGSKVVSGGAVDLKNTDGNLTISKSGDSNDVVFNLSKDFKVDGMTSGTTVVNNDGVKVGTDVALGTTGLTIANG
PAVTASGIDAGSKVISHVAAGEVSETSTDAVNGSQLNAVQAQASQPVTFSGNEGSVKRTLGQAVVISGESSTAGTYSGGN
LKSVVDEAAGAIHLQLADSPKFGNVLINNGGKISGLTAGTEDTDAVNLSQLKSISDTVDKGWTLTASGANGSKVVSGGAV
DLKNTDGNLTISKSGDSNDVVFNLSKDFKVDGMTSGTTVVNNDGVKVGSDVALGTTGLTITNGPAVTASGIDAGSKVISH
VAAGEVSETSTDAVNGSQLNAVQAQASQPVTFSGNEGSVKRTLGQAVVISGESSTAGTYSGGNLKSVVDEAAGAIHLQLA
DSPKFGNVLINNGGKISGLTAGTEDTDAVNLSQLKSISDTVDKGWTLTASGANGSKVVSGGAVDLKNTDGNLTISKSGDS
NDVVFNLSKDFKVDGMTSGTTVVNNDGVKVGSDVALGTTGLTITNGPAVTASGIDAGSKVISHVAAGEVSETSTDAVNGS
QLNAVQAQASQPVTFSGNEGSVKRTLGQAVVISGESSTAGTYSGGNLKSVVDEAAGAIHLQLADSPKFGNVLINNGGKIS
GLTAGTEDTDAVNLSQLKSISDTVDKGWTLTASGANGSKVVSGGAVDLKNTDGNLTISKSGDSNDVVFNLSEDLKEKSVT
VGNTQLDKDGVKVSSDVLLNSKSLVIMSHSSTSSVKTLEDGESVVNRTVVNGDGVNIDDVVVVNDLGLSIVGGASVTLSG
INAGSHKITNVTAGTEDTDAVNLSQLKSVSEAVDKGWTLTASGANGSSVVSGGTVDLKNTDGNLTISKSSDSNDVVFNLS
KDFKVDGVTAGNTVVNTDGVKVGSDVSLGAMGLFIANGPSVTASGFNAGDKVISHVAVGMADTDAVNVSQLKQAVQNVSV
KATRYYSTNDGGTQGGNYDGDGATGSKAVAAGVGTQASGEGATAVGSGAASSGKGSTAIGRNAIASADGSVALGDGAKDG
GRGAESYTGKYSGVQNNTMGTVSVGDAAKGETRSISNVADAKEETDAVNLRQLDAVAQKSNLQTDDMRHEINNIEDVFKV
TKGDSTPSVKGMGVNAMAIGTNAAVSGTDSVALGKNTNVSADNAVAIGNDSVADRANSVSVGSAGSQRQVTNVAAGTADT
DAVNVSQLNQGLITAKQYTDGMVGNLRRETNGGVAAAIATANLPQAYVQGRGMTSVGVSSYQGQSAIAVGVSAVSDSGHW
VFKFSGSANTRSHVGVGAGVGYQW

Specific function: Collagen-binding outer membrane protein forming a fibrillar matrix on the bacterial cell surface. Promotes attachment to eukaryotic cells and after invasion, is the major adhesin in infected tissue. Constitutes an alternative uptake pathway under conditio

COG id: COG5295

COG function: function code UW; Autotransporter adhesin

Gene ontology:

Cell location: Cell outer membrane [H]

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Belongs to the autotransporter-2 (TC 1.B.40) / oligomeric coiled-coil adhesin (Oca) family [H]

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR008640
- InterPro:   IPR008635
- InterPro:   IPR008126
- InterPro:   IPR005594 [H]

Pfam domain/function: PF05658 Hep_Hag; PF05662 HIM; PF03895 YadA [H]

EC number: NA

Molecular weight: Translated: 248048; Mature: 248048

Theoretical pI: Translated: 4.52; Mature: 4.52

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.1 %Cys     (Translated Protein)
0.8 %Met     (Translated Protein)
0.8 %Cys+Met (Translated Protein)
0.1 %Cys     (Mature Protein)
0.8 %Met     (Mature Protein)
0.8 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MVFIAPHSSKQHGKEPLHTILFAALSLSLPYAEEARAQLYINDGIDGQCQRIVDFGNTTI
CEEECCCCCHHCCCCHHHHHHHHHHHHCCCCCCCCCEEEEEECCCCCHHHHHHHCCCCEE
ESKTSPLCNEDPWTVTGYARFFGAPGATADQGNASRSLALGGVLYVNSGQFGVNDVLNKT
CCCCCCCCCCCCEEEEEEHHEECCCCCCCCCCCCCCEEEECEEEEEECCCCCHHHHHCCE
YSIRMGSVITMNTMAGTNAIAIGSAQSSAADALKASLATKATGARAIAIGAKASADGTDT
EEEEECCEEEEEECCCCCEEEEECCCCHHHHHHHHHHHHCCCCCEEEEEECCCCCCCCCE
VALGSGATAGTGASSVAIGLNASAVNGAVAVGGGALVTVPDGAVALGLNSVASTGKGLSG
EEECCCCCCCCCCCEEEEEECCCCCCCEEEECCCEEEECCCCEEEEECHHHHHCCCCCCC
YDPKTKTISTDASAAWKSTLAAVSIGDVSSSNFKTRQLSGLAAGTSNTDAVNVAQLKVVD
CCCCCCEEECCCHHHHHHHEEEEEECCCCCCCCCEEEECEEECCCCCCCCEEEEHHHHHH
EIASKGWNLTASGANSGNVGPGSSVDLKNTDKNLTITKAIGSNDVEFNLNKDVKVTTLAV
HHHHCCCEEEECCCCCCCCCCCCCEECCCCCCCEEEEEECCCCCEEEECCCCCEEEEEEE
GDALLNTDGIALGTDVALGTTGLTITNGPAVTASGIDAGSKVISHVAAGEVSETSTDAVN
CCHHCCCCCEEECCCEEECCCCEEEECCCEEEECCCCHHHHHHHHHHCCCCCCCCCCCCC
GSQLNAVQVQASQPVTFSGNEGSVKRSLGQAVVISGESSTAGTYSGGNLKSVVDEAAGAI
CCCEEEEEEECCCCEEEECCCCHHHHCCCCEEEEECCCCCCCCCCCCCHHHHHHHCCCEE
HLQLADSPKFGNVVINNGGKISGLTAGTEDTDAVNLSQLKSISDTVDKGWTLTASGANGS
EEEECCCCCCCEEEECCCCEEEEEECCCCCCCCCCHHHHHHHHHHHCCCEEEEECCCCCC
KVVSGGAVDLKNTDGNLTISKSGDSNDVVFNLSKDFKVDGMTSGTTVVNNDGVKVGTDVA
EEEECCEEEEECCCCCEEEECCCCCCCEEEEECCCCEECCCCCCCEEECCCCEEECCEEE
LGTTGLTIANGPAVTASGIDAGSKVISHVAAGEVSETSTDAVNGSQLNAVQAQASQPVTF
ECCCCEEEECCCEEEECCCCHHHHHHHHHHCCCCCCCCCCCCCCCCCEEEHHHCCCCEEE
SGNEGSVKRTLGQAVVISGESSTAGTYSGGNLKSVVDEAAGAIHLQLADSPKFGNVLINN
ECCCCCHHHCCCCEEEEECCCCCCCCCCCCCHHHHHHHCCCEEEEEECCCCCCCCEEECC
GGKISGLTAGTEDTDAVNLSQLKSISDTVDKGWTLTASGANGSKVVSGGAVDLKNTDGNL
CCEEEEEECCCCCCCCCCHHHHHHHHHHHCCCEEEEECCCCCCEEEECCEEEEECCCCCE
TISKSGDSNDVVFNLSKDFKVDGMTSGTTVVNNDGVKVGSDVALGTTGLTITNGPAVTAS
EEECCCCCCCEEEEECCCCEECCCCCCCEEECCCCCEECCCEEECCCCEEEECCCEEEEC
GIDAGSKVISHVAAGEVSETSTDAVNGSQLNAVQAQASQPVTFSGNEGSVKRTLGQAVVI
CCCHHHHHHHHHHCCCCCCCCCCCCCCCCCEEEHHHCCCCEEEECCCCCHHHCCCCEEEE
SGESSTAGTYSGGNLKSVVDEAAGAIHLQLADSPKFGNVLINNGGKISGLTAGTEDTDAV
ECCCCCCCCCCCCCHHHHHHHCCCEEEEEECCCCCCCCEEECCCCEEEEEECCCCCCCCC
NLSQLKSISDTVDKGWTLTASGANGSKVVSGGAVDLKNTDGNLTISKSGDSNDVVFNLSK
CHHHHHHHHHHHCCCEEEEECCCCCCEEEECCEEEEECCCCCEEEECCCCCCCEEEEECC
DFKVDGMTSGTTVVNNDGVKVGTDVALGTTGLTIANGPAVTASGIDAGSKVISHVAAGEV
CCEECCCCCCCEEECCCCEEECCEEEECCCCEEEECCCEEEECCCCHHHHHHHHHHCCCC
SETSTDAVNGSQLNAVQAQASQPVTFSGNEGSVKRTLGQAVVISGESSTAGTYSGGNLKS
CCCCCCCCCCCCCEEEHHHCCCCEEEECCCCCHHHCCCCEEEEECCCCCCCCCCCCCHHH
VVDEAAGAIHLQLADSPKFGNVVINNGGKISGLTAGTEDTDAVNLSQLKSISDTVDKGWT
HHHHCCCEEEEEECCCCCCCEEEECCCCEEEEEECCCCCCCCCCHHHHHHHHHHHCCCEE
LTASGANGSKVVSGGAVDLKNTDGNLTISKSGDSNDVVFNLSKDFKVDGMTSGTTVVNND
EEECCCCCCEEEECCEEEEECCCCCEEEECCCCCCCEEEEECCCCEECCCCCCCEEECCC
GVKVGTDVALGTTGLTIANGPAVTASGIDAGSKVISHVAAGEVSETSTDAVNGSQLNAVQ
CEEECCEEEECCCCEEEECCCEEEECCCCHHHHHHHHHHCCCCCCCCCCCCCCCCCEEEH
AQASQPVTFSGNEGSVKRTLGQAVVISGESSTAGTYSGGNLKSVVDEAAGAIHLQLADSP
HHCCCCEEEECCCCCHHHCCCCEEEEECCCCCCCCCCCCCHHHHHHHCCCEEEEEECCCC
KFGNVLINNGGKISGLTAGTEDTDAVNLSQLKSISDTVDKGWTLTASGANGSKVVSGGAV
CCCCEEECCCCEEEEEECCCCCCCCCCHHHHHHHHHHHCCCEEEEECCCCCCEEEECCEE
DLKNTDGNLTISKSGDSNDVVFNLSKDFKVDGMTSGTTVVNNDGVKVGSDVALGTTGLTI
EEECCCCCEEEECCCCCCCEEEEECCCCEECCCCCCCEEECCCCCEECCCEEECCCCEEE
TNGPAVTASGIDAGSKVISHVAAGEVSETSTDAVNGSQLNAVQAQASQPVTFSGNEGSVK
ECCCEEEECCCCHHHHHHHHHHCCCCCCCCCCCCCCCCCEEEHHHCCCCEEEECCCCCHH
RTLGQAVVISGESSTAGTYSGGNLKSVVDEAAGAIHLQLADSPKFGNVLINNGGKISGLT
HCCCCEEEEECCCCCCCCCCCCCHHHHHHHCCCEEEEEECCCCCCCCEEECCCCEEEEEE
AGTEDTDAVNLSQLKSISDTVDKGWTLTASGANGSKVVSGGAVDLKNTDGNLTISKSGDS
CCCCCCCCCCHHHHHHHHHHHCCCEEEEECCCCCCEEEECCEEEEECCCCCEEEECCCCC
NDVVFNLSKDFKVDGMTSGTTVVNNDGVKVGSDVALGTTGLTITNGPAVTASGIDAGSKV
CCEEEEECCCCEECCCCCCCEEECCCCCEECCCEEECCCCEEEECCCEEEECCCCHHHHH
ISHVAAGEVSETSTDAVNGSQLNAVQAQASQPVTFSGNEGSVKRTLGQAVVISGESSTAG
HHHHHCCCCCCCCCCCCCCCCCEEEHHHCCCCEEEECCCCCHHHCCCCEEEEECCCCCCC
TYSGGNLKSVVDEAAGAIHLQLADSPKFGNVLINNGGKISGLTAGTEDTDAVNLSQLKSI
CCCCCCHHHHHHHCCCEEEEEECCCCCCCCEEECCCCEEEEEECCCCCCCCCCHHHHHHH
SDTVDKGWTLTASGANGSKVVSGGAVDLKNTDGNLTISKSGDSNDVVFNLSEDLKEKSVT
HHHHCCCEEEEECCCCCCEEEECCEEEEECCCCCEEEECCCCCCCEEEECHHHHHHCCEE
VGNTQLDKDGVKVSSDVLLNSKSLVIMSHSSTSSVKTLEDGESVVNRTVVNGDGVNIDDV
ECCCEECCCCCEEECEEEECCCEEEEEECCCCCCCEEHHCCHHHHHEEEECCCCCCCCCE
VVVNDLGLSIVGGASVTLSGINAGSHKITNVTAGTEDTDAVNLSQLKSVSEAVDKGWTLT
EEEECCCEEEECCCEEEEEECCCCCEEEEEEECCCCCCCCCCHHHHHHHHHHHHCCCEEE
ASGANGSSVVSGGTVDLKNTDGNLTISKSSDSNDVVFNLSKDFKVDGVTAGNTVVNTDGV
ECCCCCCEEECCCEEEEECCCCCEEEECCCCCCCEEEEECCCCEECCEECCCEEEECCCE
KVGSDVSLGAMGLFIANGPSVTASGFNAGDKVISHVAVGMADTDAVNVSQLKQAVQNVSV
EECCCCCCCEEEEEEECCCCEEECCCCCHHHHHHHHHCCCCCCCCCCHHHHHHHHHCCEE
KATRYYSTNDGGTQGGNYDGDGATGSKAVAAGVGTQASGEGATAVGSGAASSGKGSTAIG
EEEEEEECCCCCCCCCCCCCCCCCCCCEEEECCCCCCCCCCCEEECCCCCCCCCCCCCCC
RNAIASADGSVALGDGAKDGGRGAESYTGKYSGVQNNTMGTVSVGDAAKGETRSISNVAD
CCCCCCCCCCEEECCCCCCCCCCCCCCCCCCCCCCCCCEEEEEECCCCCCCCCCHHHHHH
AKEETDAVNLRQLDAVAQKSNLQTDDMRHEINNIEDVFKVTKGDSTPSVKGMGVNAMAIG
CHHHCCCCCHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHCCCCCCCEECCCEEEEEEC
TNAAVSGTDSVALGKNTNVSADNAVAIGNDSVADRANSVSVGSAGSQRQVTNVAAGTADT
CCCEECCCCCEEECCCCCCCCCCEEEECCCHHHCCCCCEEECCCCCCCEEEEEECCCCCC
DAVNVSQLNQGLITAKQYTDGMVGNLRRETNGGVAAAIATANLPQAYVQGRGMTSVGVSS
CCEEHHHHCCCEEEEHHHCCCHHHCCEECCCCCEEEEEEECCCCHHHHCCCCCCCCCCCC
YQGQSAIAVGVSAVSDSGHWVFKFSGSANTRSHVGVGAGVGYQW
CCCCCEEEEEEEEECCCCCEEEEECCCCCCCCCCCCCCCCCCCC
>Mature Secondary Structure
MVFIAPHSSKQHGKEPLHTILFAALSLSLPYAEEARAQLYINDGIDGQCQRIVDFGNTTI
CEEECCCCCHHCCCCHHHHHHHHHHHHCCCCCCCCCEEEEEECCCCCHHHHHHHCCCCEE
ESKTSPLCNEDPWTVTGYARFFGAPGATADQGNASRSLALGGVLYVNSGQFGVNDVLNKT
CCCCCCCCCCCCEEEEEEHHEECCCCCCCCCCCCCCEEEECEEEEEECCCCCHHHHHCCE
YSIRMGSVITMNTMAGTNAIAIGSAQSSAADALKASLATKATGARAIAIGAKASADGTDT
EEEEECCEEEEEECCCCCEEEEECCCCHHHHHHHHHHHHCCCCCEEEEEECCCCCCCCCE
VALGSGATAGTGASSVAIGLNASAVNGAVAVGGGALVTVPDGAVALGLNSVASTGKGLSG
EEECCCCCCCCCCCEEEEEECCCCCCCEEEECCCEEEECCCCEEEEECHHHHHCCCCCCC
YDPKTKTISTDASAAWKSTLAAVSIGDVSSSNFKTRQLSGLAAGTSNTDAVNVAQLKVVD
CCCCCCEEECCCHHHHHHHEEEEEECCCCCCCCCEEEECEEECCCCCCCCEEEEHHHHHH
EIASKGWNLTASGANSGNVGPGSSVDLKNTDKNLTITKAIGSNDVEFNLNKDVKVTTLAV
HHHHCCCEEEECCCCCCCCCCCCCEECCCCCCCEEEEEECCCCCEEEECCCCCEEEEEEE
GDALLNTDGIALGTDVALGTTGLTITNGPAVTASGIDAGSKVISHVAAGEVSETSTDAVN
CCHHCCCCCEEECCCEEECCCCEEEECCCEEEECCCCHHHHHHHHHHCCCCCCCCCCCCC
GSQLNAVQVQASQPVTFSGNEGSVKRSLGQAVVISGESSTAGTYSGGNLKSVVDEAAGAI
CCCEEEEEEECCCCEEEECCCCHHHHCCCCEEEEECCCCCCCCCCCCCHHHHHHHCCCEE
HLQLADSPKFGNVVINNGGKISGLTAGTEDTDAVNLSQLKSISDTVDKGWTLTASGANGS
EEEECCCCCCCEEEECCCCEEEEEECCCCCCCCCCHHHHHHHHHHHCCCEEEEECCCCCC
KVVSGGAVDLKNTDGNLTISKSGDSNDVVFNLSKDFKVDGMTSGTTVVNNDGVKVGTDVA
EEEECCEEEEECCCCCEEEECCCCCCCEEEEECCCCEECCCCCCCEEECCCCEEECCEEE
LGTTGLTIANGPAVTASGIDAGSKVISHVAAGEVSETSTDAVNGSQLNAVQAQASQPVTF
ECCCCEEEECCCEEEECCCCHHHHHHHHHHCCCCCCCCCCCCCCCCCEEEHHHCCCCEEE
SGNEGSVKRTLGQAVVISGESSTAGTYSGGNLKSVVDEAAGAIHLQLADSPKFGNVLINN
ECCCCCHHHCCCCEEEEECCCCCCCCCCCCCHHHHHHHCCCEEEEEECCCCCCCCEEECC
GGKISGLTAGTEDTDAVNLSQLKSISDTVDKGWTLTASGANGSKVVSGGAVDLKNTDGNL
CCEEEEEECCCCCCCCCCHHHHHHHHHHHCCCEEEEECCCCCCEEEECCEEEEECCCCCE
TISKSGDSNDVVFNLSKDFKVDGMTSGTTVVNNDGVKVGSDVALGTTGLTITNGPAVTAS
EEECCCCCCCEEEEECCCCEECCCCCCCEEECCCCCEECCCEEECCCCEEEECCCEEEEC
GIDAGSKVISHVAAGEVSETSTDAVNGSQLNAVQAQASQPVTFSGNEGSVKRTLGQAVVI
CCCHHHHHHHHHHCCCCCCCCCCCCCCCCCEEEHHHCCCCEEEECCCCCHHHCCCCEEEE
SGESSTAGTYSGGNLKSVVDEAAGAIHLQLADSPKFGNVLINNGGKISGLTAGTEDTDAV
ECCCCCCCCCCCCCHHHHHHHCCCEEEEEECCCCCCCCEEECCCCEEEEEECCCCCCCCC
NLSQLKSISDTVDKGWTLTASGANGSKVVSGGAVDLKNTDGNLTISKSGDSNDVVFNLSK
CHHHHHHHHHHHCCCEEEEECCCCCCEEEECCEEEEECCCCCEEEECCCCCCCEEEEECC
DFKVDGMTSGTTVVNNDGVKVGTDVALGTTGLTIANGPAVTASGIDAGSKVISHVAAGEV
CCEECCCCCCCEEECCCCEEECCEEEECCCCEEEECCCEEEECCCCHHHHHHHHHHCCCC
SETSTDAVNGSQLNAVQAQASQPVTFSGNEGSVKRTLGQAVVISGESSTAGTYSGGNLKS
CCCCCCCCCCCCCEEEHHHCCCCEEEECCCCCHHHCCCCEEEEECCCCCCCCCCCCCHHH
VVDEAAGAIHLQLADSPKFGNVVINNGGKISGLTAGTEDTDAVNLSQLKSISDTVDKGWT
HHHHCCCEEEEEECCCCCCCEEEECCCCEEEEEECCCCCCCCCCHHHHHHHHHHHCCCEE
LTASGANGSKVVSGGAVDLKNTDGNLTISKSGDSNDVVFNLSKDFKVDGMTSGTTVVNND
EEECCCCCCEEEECCEEEEECCCCCEEEECCCCCCCEEEEECCCCEECCCCCCCEEECCC
GVKVGTDVALGTTGLTIANGPAVTASGIDAGSKVISHVAAGEVSETSTDAVNGSQLNAVQ
CEEECCEEEECCCCEEEECCCEEEECCCCHHHHHHHHHHCCCCCCCCCCCCCCCCCEEEH
AQASQPVTFSGNEGSVKRTLGQAVVISGESSTAGTYSGGNLKSVVDEAAGAIHLQLADSP
HHCCCCEEEECCCCCHHHCCCCEEEEECCCCCCCCCCCCCHHHHHHHCCCEEEEEECCCC
KFGNVLINNGGKISGLTAGTEDTDAVNLSQLKSISDTVDKGWTLTASGANGSKVVSGGAV
CCCCEEECCCCEEEEEECCCCCCCCCCHHHHHHHHHHHCCCEEEEECCCCCCEEEECCEE
DLKNTDGNLTISKSGDSNDVVFNLSKDFKVDGMTSGTTVVNNDGVKVGSDVALGTTGLTI
EEECCCCCEEEECCCCCCCEEEEECCCCEECCCCCCCEEECCCCCEECCCEEECCCCEEE
TNGPAVTASGIDAGSKVISHVAAGEVSETSTDAVNGSQLNAVQAQASQPVTFSGNEGSVK
ECCCEEEECCCCHHHHHHHHHHCCCCCCCCCCCCCCCCCEEEHHHCCCCEEEECCCCCHH
RTLGQAVVISGESSTAGTYSGGNLKSVVDEAAGAIHLQLADSPKFGNVLINNGGKISGLT
HCCCCEEEEECCCCCCCCCCCCCHHHHHHHCCCEEEEEECCCCCCCCEEECCCCEEEEEE
AGTEDTDAVNLSQLKSISDTVDKGWTLTASGANGSKVVSGGAVDLKNTDGNLTISKSGDS
CCCCCCCCCCHHHHHHHHHHHCCCEEEEECCCCCCEEEECCEEEEECCCCCEEEECCCCC
NDVVFNLSKDFKVDGMTSGTTVVNNDGVKVGSDVALGTTGLTITNGPAVTASGIDAGSKV
CCEEEEECCCCEECCCCCCCEEECCCCCEECCCEEECCCCEEEECCCEEEECCCCHHHHH
ISHVAAGEVSETSTDAVNGSQLNAVQAQASQPVTFSGNEGSVKRTLGQAVVISGESSTAG
HHHHHCCCCCCCCCCCCCCCCCEEEHHHCCCCEEEECCCCCHHHCCCCEEEEECCCCCCC
TYSGGNLKSVVDEAAGAIHLQLADSPKFGNVLINNGGKISGLTAGTEDTDAVNLSQLKSI
CCCCCCHHHHHHHCCCEEEEEECCCCCCCCEEECCCCEEEEEECCCCCCCCCCHHHHHHH
SDTVDKGWTLTASGANGSKVVSGGAVDLKNTDGNLTISKSGDSNDVVFNLSEDLKEKSVT
HHHHCCCEEEEECCCCCCEEEECCEEEEECCCCCEEEECCCCCCCEEEECHHHHHHCCEE
VGNTQLDKDGVKVSSDVLLNSKSLVIMSHSSTSSVKTLEDGESVVNRTVVNGDGVNIDDV
ECCCEECCCCCEEECEEEECCCEEEEEECCCCCCCEEHHCCHHHHHEEEECCCCCCCCCE
VVVNDLGLSIVGGASVTLSGINAGSHKITNVTAGTEDTDAVNLSQLKSVSEAVDKGWTLT
EEEECCCEEEECCCEEEEEECCCCCEEEEEEECCCCCCCCCCHHHHHHHHHHHHCCCEEE
ASGANGSSVVSGGTVDLKNTDGNLTISKSSDSNDVVFNLSKDFKVDGVTAGNTVVNTDGV
ECCCCCCEEECCCEEEEECCCCCEEEECCCCCCCEEEEECCCCEECCEECCCEEEECCCE
KVGSDVSLGAMGLFIANGPSVTASGFNAGDKVISHVAVGMADTDAVNVSQLKQAVQNVSV
EECCCCCCCEEEEEEECCCCEEECCCCCHHHHHHHHHCCCCCCCCCCHHHHHHHHHCCEE
KATRYYSTNDGGTQGGNYDGDGATGSKAVAAGVGTQASGEGATAVGSGAASSGKGSTAIG
EEEEEEECCCCCCCCCCCCCCCCCCCCEEEECCCCCCCCCCCEEECCCCCCCCCCCCCCC
RNAIASADGSVALGDGAKDGGRGAESYTGKYSGVQNNTMGTVSVGDAAKGETRSISNVAD
CCCCCCCCCCEEECCCCCCCCCCCCCCCCCCCCCCCCCEEEEEECCCCCCCCCCHHHHHH
AKEETDAVNLRQLDAVAQKSNLQTDDMRHEINNIEDVFKVTKGDSTPSVKGMGVNAMAIG
CHHHCCCCCHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHCCCCCCCEECCCEEEEEEC
TNAAVSGTDSVALGKNTNVSADNAVAIGNDSVADRANSVSVGSAGSQRQVTNVAAGTADT
CCCEECCCCCEEECCCCCCCCCCEEEECCCHHHCCCCCEEECCCCCCCEEEEEECCCCCC
DAVNVSQLNQGLITAKQYTDGMVGNLRRETNGGVAAAIATANLPQAYVQGRGMTSVGVSS
CCEEHHHHCCCEEEEHHHCCCHHHCCEECCCCCEEEEEEECCCCHHHHCCCCCCCCCCCC
YQGQSAIAVGVSAVSDSGHWVFKFSGSANTRSHVGVGAGVGYQW
CCCCCEEEEEEEEECCCCCEEEEECCCCCCCCCCCCCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 3043229; 2761389; 2592347; 1548243; 12183532 [H]