| Definition | Yersinia pseudotuberculosis IP 31758, complete genome. |
|---|---|
| Accession | NC_009708 |
| Length | 4,723,306 |
Click here to switch to the map view.
The map label for this gene is yadA [H]
Identifier: 153947101
GI number: 153947101
Start: 1919149
End: 1921791
Strand: Direct
Name: yadA [H]
Synonym: YpsIP31758_1650
Alternate gene names: 153947101
Gene position: 1919149-1921791 (Clockwise)
Preceding gene: 153947682
Following gene: 153950540
Centisome position: 40.63
GC content: 57.78
Gene sequence:
>2643_bases ATGAAAAGTATCCAAAAGTGTGACTGTAATTATCTGGCCAGATTTGCAGTTTCAGATTCCTTTATCAGAGATAATTCTTT TCGCGGCTTGCTTGCTATTTTTATGGTGACGATATTTGTGCCAGGTACTGCATTTTCTGAACTCTATGTGAACAATGCCA ATGATCCTGGCTGTTATGCCGTTGTGGATGATAATAATCTGAATTTTAAGGGGAGGATCACCGGTATTGTTACTAACCAT ATATATTGTAATACGTTGACTGAGGCGAATCTGAATACCAATGGGGGGCAGCTATTTGTTGGCGGACAAGGCGGGCTCCC AGGGTACGCTCCCACCCCCTGGACAGGGACATTCACGACGGCCGTTGGCACCAGTAATGTCGCCACAGCATACGGCTTTG TCGTTCAAAAAAATGGTGCATTTATCAACGGTGATACCTACGTGCAGGGGGGGTTATTTTTGAATGGTAGGAAAGCCACC AATCTTGCCCCCGCAACGATTTCATCGACCTCCACCGATGCGGTGGTTGGTAGCCAGCTTTATACGGTGATCCAAGATGG AACCCGCTATTTCCACGCCAACTCAGCGAACCCGCAAGACTCCGTGCCTACGGGTCAGGATGCTATTGCTGTCGGGCCGG CGACGGTGGTCAATGGTAATAACGGGATTGGTATTGGTAATAGCGCCGTTGTTGGGCCGAGTGCTGTCGGGGGCATTGCA ATTGGCCCCAACACTCAGGCGACCGGTACCGCCAGCACGGCCCTTGGTGCCGGAACGCAGGCGCAGGGGGCACAGTCTTT GGCTCTTGGGGCCGGGGCGGTTACCCGCCAGGTAAACAGTATTGCGTTAGGGGCGTCGTCGGTCACCACGGTGGGCGCTC AGGGCAGCTACAGTGCATACGGACTGCCGACCACGCAGGCGTCGGTGGGGGAAGTGGGCATAGGGACCGCGCAGGGTAAT CGCAAGATCACCGGTGTGGCAGCGGGCTCGGCTGGTTATGATGCGGTCAACGTGACTCAGTTGACTGCTGTTGGTAATAA AGTCGACCAAAATACCGCTGACATTACCAGTTTAGACGGCCGGGTCACCAATGTTGAGGGGGGGATGACCAGCATCACCA ACGGGGGCGGTATAAAGTACTTCCACACTCACTCCACCGAGCCTGATTCGGTGGCCAGCGGCAGTGATTCGGTGGCGATC GGACCGAATGCGCAGGCGTCCGGTACCACGTCGATAGCCATGGGGGCCGGGTCGACAGCGCAGGGAGCACAGTCTCTGGC ATTGGGGGCGGGAGCGGCTGCCAGCCAGGCAAACAGTATTGCGTTAGGGGCGTCATCGGTCACCACGGTCGGTGCTGAGA GCAACTACAGTGCGTACGGACTGACAGCTTCCCAAACGTCGGTGGGCGAGGTGGGGGTGGGCACGGCACAGGGGAATCGC AAGATCACCGGTGTGGCAGCCGGTTCGGCTGATTATGATGCGGTCAATGTCGCGCAATTGACCGCTGTTGGTGACAAGGT CGATCAGAATACCGCTGACATCACCAGTTTAGACGGCCGGGTCACCAATGTTGAGGGGGAGATGACCAGCATCACCAACG GGGGCGGCGTGAAATACTTCCACACCCACTCCACCGAGCCTGATTCGGTGGCCAGCGGCAGTGATTCGGTGGCGATCGGA CCGAATGCGCAGGCGTCAGGTACGGCTTCGGTGGCCTCCGGCAAGGATACGCTGGCCTCCGGTAACGGTGCGGTGGCGAT AGGTGATGCAGCAAGCGTCAGCGCAGAGGGCAGTGTTGCCCTGGGGCAGGGTTCCGCTGACAACGGGCGCGGTGCAGAGA GCTACACCGGCAAGTACTCCACTGCGGATAACACCACCTCAGGTACGGTGTCGGTGGGCAATGCGGCAACCGGAGAGACC CGGACGGTCAGCAACGTTGCCGACGGGCGAGAGGCCATGGATGCAGTCAATCTGCGGCAACTCGATGGTGCAATGGCGGC GGTGGGTGACACCGTATCAGGGTTGCAGAACGGCACTGACGGGATGTTCCAGGTGAACAACAACAGCGGTCAGGCCAAGC CTTCGGCCACCGGAACTGATGCGATGGCGGGGGGGGCAGGTTCCGTGGCGTCTGGCAGCCACAGTACCGCGATGGGTACG GGCAGCAAGGCGACGGCGGCAAACAGCACCGCGCTGGGGGCCAACTCAGTGGCGGATCGTGAAAACAGTGTCTCGGTGGG GTCAGTGGGTAATGAACGGCAGCTCACTAATGTTGCTGCGGGGACTCAGGGCACTGATGCGGTGAATCTGGATCAACTCA ACCATAGCATGTCGAATGTCACCAACGACGCCAATGCTTATACAGACCAGCGCTATTCTGCACTTAAAGAAGATCTGAAA AAACAGGATAGTACGTTAAGTGCGGGGATCGCCGGTGCCATGGCGATGGCGAGCCTGACTCAACCCTATACGCCGGGTGC CAGCATGGCGACCATTGGTGCGGCCAGCTATCGGGGCCAGTCGGCGCTGTCGGTGGGGGTGTCGAGTATTTCTGACAGTG GGCGATGGGTCAGCAAATTGCAGGCCTCCTCTAATACACAAGGCGATATGGGGGTTGGTGTCGGCGTCGGTTATCAATGG TAA
Upstream 100 bases:
>100_bases CTTCGATTCACTCAGTGCCATACAGGAGCGGGTTTGAACGTCTTTGCTTAATAATTTGTCACCAATGTCAAAAGGTGAAC AAGAATAAAATGGGGATGGT
Downstream 100 bases:
>100_bases AGAAAGGCCAACACTGAATATTGTTTAATAATCATTAACGGGTTGTGCGATTTTTTGCACAGCCCGATTCTACTTCTTAG GGATTAAAAGGCAGCACCCA
Product: hemagglutination repeat-containing protein
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 880; Mature: 880
Protein sequence:
>880_residues MKSIQKCDCNYLARFAVSDSFIRDNSFRGLLAIFMVTIFVPGTAFSELYVNNANDPGCYAVVDDNNLNFKGRITGIVTNH IYCNTLTEANLNTNGGQLFVGGQGGLPGYAPTPWTGTFTTAVGTSNVATAYGFVVQKNGAFINGDTYVQGGLFLNGRKAT NLAPATISSTSTDAVVGSQLYTVIQDGTRYFHANSANPQDSVPTGQDAIAVGPATVVNGNNGIGIGNSAVVGPSAVGGIA IGPNTQATGTASTALGAGTQAQGAQSLALGAGAVTRQVNSIALGASSVTTVGAQGSYSAYGLPTTQASVGEVGIGTAQGN RKITGVAAGSAGYDAVNVTQLTAVGNKVDQNTADITSLDGRVTNVEGGMTSITNGGGIKYFHTHSTEPDSVASGSDSVAI GPNAQASGTTSIAMGAGSTAQGAQSLALGAGAAASQANSIALGASSVTTVGAESNYSAYGLTASQTSVGEVGVGTAQGNR KITGVAAGSADYDAVNVAQLTAVGDKVDQNTADITSLDGRVTNVEGEMTSITNGGGVKYFHTHSTEPDSVASGSDSVAIG PNAQASGTASVASGKDTLASGNGAVAIGDAASVSAEGSVALGQGSADNGRGAESYTGKYSTADNTTSGTVSVGNAATGET RTVSNVADGREAMDAVNLRQLDGAMAAVGDTVSGLQNGTDGMFQVNNNSGQAKPSATGTDAMAGGAGSVASGSHSTAMGT GSKATAANSTALGANSVADRENSVSVGSVGNERQLTNVAAGTQGTDAVNLDQLNHSMSNVTNDANAYTDQRYSALKEDLK KQDSTLSAGIAGAMAMASLTQPYTPGASMATIGAASYRGQSALSVGVSSISDSGRWVSKLQASSNTQGDMGVGVGVGYQW
Sequences:
>Translated_880_residues MKSIQKCDCNYLARFAVSDSFIRDNSFRGLLAIFMVTIFVPGTAFSELYVNNANDPGCYAVVDDNNLNFKGRITGIVTNH IYCNTLTEANLNTNGGQLFVGGQGGLPGYAPTPWTGTFTTAVGTSNVATAYGFVVQKNGAFINGDTYVQGGLFLNGRKAT NLAPATISSTSTDAVVGSQLYTVIQDGTRYFHANSANPQDSVPTGQDAIAVGPATVVNGNNGIGIGNSAVVGPSAVGGIA IGPNTQATGTASTALGAGTQAQGAQSLALGAGAVTRQVNSIALGASSVTTVGAQGSYSAYGLPTTQASVGEVGIGTAQGN RKITGVAAGSAGYDAVNVTQLTAVGNKVDQNTADITSLDGRVTNVEGGMTSITNGGGIKYFHTHSTEPDSVASGSDSVAI GPNAQASGTTSIAMGAGSTAQGAQSLALGAGAAASQANSIALGASSVTTVGAESNYSAYGLTASQTSVGEVGVGTAQGNR KITGVAAGSADYDAVNVAQLTAVGDKVDQNTADITSLDGRVTNVEGEMTSITNGGGVKYFHTHSTEPDSVASGSDSVAIG PNAQASGTASVASGKDTLASGNGAVAIGDAASVSAEGSVALGQGSADNGRGAESYTGKYSTADNTTSGTVSVGNAATGET RTVSNVADGREAMDAVNLRQLDGAMAAVGDTVSGLQNGTDGMFQVNNNSGQAKPSATGTDAMAGGAGSVASGSHSTAMGT GSKATAANSTALGANSVADRENSVSVGSVGNERQLTNVAAGTQGTDAVNLDQLNHSMSNVTNDANAYTDQRYSALKEDLK KQDSTLSAGIAGAMAMASLTQPYTPGASMATIGAASYRGQSALSVGVSSISDSGRWVSKLQASSNTQGDMGVGVGVGYQW >Mature_880_residues MKSIQKCDCNYLARFAVSDSFIRDNSFRGLLAIFMVTIFVPGTAFSELYVNNANDPGCYAVVDDNNLNFKGRITGIVTNH IYCNTLTEANLNTNGGQLFVGGQGGLPGYAPTPWTGTFTTAVGTSNVATAYGFVVQKNGAFINGDTYVQGGLFLNGRKAT NLAPATISSTSTDAVVGSQLYTVIQDGTRYFHANSANPQDSVPTGQDAIAVGPATVVNGNNGIGIGNSAVVGPSAVGGIA IGPNTQATGTASTALGAGTQAQGAQSLALGAGAVTRQVNSIALGASSVTTVGAQGSYSAYGLPTTQASVGEVGIGTAQGN RKITGVAAGSAGYDAVNVTQLTAVGNKVDQNTADITSLDGRVTNVEGGMTSITNGGGIKYFHTHSTEPDSVASGSDSVAI GPNAQASGTTSIAMGAGSTAQGAQSLALGAGAAASQANSIALGASSVTTVGAESNYSAYGLTASQTSVGEVGVGTAQGNR KITGVAAGSADYDAVNVAQLTAVGDKVDQNTADITSLDGRVTNVEGEMTSITNGGGVKYFHTHSTEPDSVASGSDSVAIG PNAQASGTASVASGKDTLASGNGAVAIGDAASVSAEGSVALGQGSADNGRGAESYTGKYSTADNTTSGTVSVGNAATGET RTVSNVADGREAMDAVNLRQLDGAMAAVGDTVSGLQNGTDGMFQVNNNSGQAKPSATGTDAMAGGAGSVASGSHSTAMGT GSKATAANSTALGANSVADRENSVSVGSVGNERQLTNVAAGTQGTDAVNLDQLNHSMSNVTNDANAYTDQRYSALKEDLK KQDSTLSAGIAGAMAMASLTQPYTPGASMATIGAASYRGQSALSVGVSSISDSGRWVSKLQASSNTQGDMGVGVGVGYQW
Specific function: Collagen-binding outer membrane protein forming a fibrillar matrix on the bacterial cell surface. Promotes attachment to eukaryotic cells and after invasion, is the major adhesin in infected tissue. Constitutes an alternative uptake pathway under conditio
COG id: COG5295
COG function: function code UW; Autotransporter adhesin
Gene ontology:
Cell location: Cell outer membrane [H]
Metaboloic importance: NA
Operon status: Not Known
Operon components: None
Similarity: Belongs to the autotransporter-2 (TC 1.B.40) / oligomeric coiled-coil adhesin (Oca) family [H]
Homologues:
None
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR008640 - InterPro: IPR008635 - InterPro: IPR008126 - InterPro: IPR005594 [H]
Pfam domain/function: PF05658 Hep_Hag; PF05662 HIM; PF03895 YadA [H]
EC number: NA
Molecular weight: Translated: 86906; Mature: 86906
Theoretical pI: Translated: 4.49; Mature: 4.49
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.5 %Cys (Translated Protein) 1.7 %Met (Translated Protein) 2.2 %Cys+Met (Translated Protein) 0.5 %Cys (Mature Protein) 1.7 %Met (Mature Protein) 2.2 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MKSIQKCDCNYLARFAVSDSFIRDNSFRGLLAIFMVTIFVPGTAFSELYVNNANDPGCYA CCCHHHCCHHHHHHHHHCCCHHCCCCCHHHHHHHHHHHHCCCCCEEEEEEECCCCCCEEE VVDDNNLNFKGRITGIVTNHIYCNTLTEANLNTNGGQLFVGGQGGLPGYAPTPWTGTFTT EECCCCCCEEEEEEEEEECEEEEEEEEECCCCCCCCEEEECCCCCCCCCCCCCCCCEEEE AVGTSNVATAYGFVVQKNGAFINGDTYVQGGLFLNGRKATNLAPATISSTSTDAVVGSQL ECCCCCCCEEEEEEEECCCCEECCCEEEECCEEECCCCCCCCCCCEECCCCCCHHHHHHH YTVIQDGTRYFHANSANPQDSVPTGQDAIAVGPATVVNGNNGIGIGNSAVVGPSAVGGIA HHHHHCCCEEEECCCCCCCCCCCCCCCEEEECCEEEEECCCCCCCCCCCEECCCCCCCEE IGPNTQATGTASTALGAGTQAQGAQSLALGAGAVTRQVNSIALGASSVTTVGAQGSYSAY ECCCCCCCCCCHHHHCCCCCCCCCCHHHHCCHHHHHHHHHEEECCCCEEEECCCCCCCCC GLPTTQASVGEVGIGTAQGNRKITGVAAGSAGYDAVNVTQLTAVGNKVDQNTADITSLDG CCCCCCCCCCCCEEEECCCCEEEEEEECCCCCCCEEEEEEEEECCCCCCCCCCCEEECCC RVTNVEGGMTSITNGGGIKYFHTHSTEPDSVASGSDSVAIGPNAQASGTTSIAMGAGSTA EEEEECCCCEEECCCCCEEEEECCCCCCCCCCCCCCCEEECCCCCCCCCEEEEECCCCCC QGAQSLALGAGAAASQANSIALGASSVTTVGAESNYSAYGLTASQTSVGEVGVGTAQGNR CCCHHHEECCCCCCCCCCEEEECCCCEEEECCCCCCCEEEEECCCCCCCCCCCEECCCCE KITGVAAGSADYDAVNVAQLTAVGDKVDQNTADITSLDGRVTNVEGEMTSITNGGGVKYF EEEEEECCCCCCCCEEEEEEEECCCCCCCCCCCEEECCCEEEECCCCEEEECCCCCEEEE HTHSTEPDSVASGSDSVAIGPNAQASGTASVASGKDTLASGNGAVAIGDAASVSAEGSVA ECCCCCCCCCCCCCCCEEECCCCCCCCCEEECCCCCCEECCCCCEEECCCCCCCCCCCEE LGQGSADNGRGAESYTGKYSTADNTTSGTVSVGNAATGETRTVSNVADGREAMDAVNLRQ ECCCCCCCCCCCCCCCCCCCCCCCCCCCEEEECCCCCCCCEEHHHHHCCHHHHHHHHHHH LDGAMAAVGDTVSGLQNGTDGMFQVNNNSGQAKPSATGTDAMAGGAGSVASGSHSTAMGT HCCHHHHHHHHHHHHCCCCCCEEEEECCCCCCCCCCCCCCHHCCCCCCCCCCCCCCCCCC GSKATAANSTALGANSVADRENSVSVGSVGNERQLTNVAAGTQGTDAVNLDQLNHSMSNV CCCCCCCCCCCCCCCCCCCCCCCEEECCCCCCCCCCEEECCCCCCCCEEHHHHHHHHHHC TNDANAYTDQRYSALKEDLKKQDSTLSAGIAGAMAMASLTQPYTPGASMATIGAASYRGQ CCCCHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHCCCCCCCCCEEEECCHHCCCC SALSVGVSSISDSGRWVSKLQASSNTQGDMGVGVGVGYQW HHHHHHHHHCCCCCHHHHHHHHCCCCCCCCCEEECCCCCC >Mature Secondary Structure MKSIQKCDCNYLARFAVSDSFIRDNSFRGLLAIFMVTIFVPGTAFSELYVNNANDPGCYA CCCHHHCCHHHHHHHHHCCCHHCCCCCHHHHHHHHHHHHCCCCCEEEEEEECCCCCCEEE VVDDNNLNFKGRITGIVTNHIYCNTLTEANLNTNGGQLFVGGQGGLPGYAPTPWTGTFTT EECCCCCCEEEEEEEEEECEEEEEEEEECCCCCCCCEEEECCCCCCCCCCCCCCCCEEEE AVGTSNVATAYGFVVQKNGAFINGDTYVQGGLFLNGRKATNLAPATISSTSTDAVVGSQL ECCCCCCCEEEEEEEECCCCEECCCEEEECCEEECCCCCCCCCCCEECCCCCCHHHHHHH YTVIQDGTRYFHANSANPQDSVPTGQDAIAVGPATVVNGNNGIGIGNSAVVGPSAVGGIA HHHHHCCCEEEECCCCCCCCCCCCCCCEEEECCEEEEECCCCCCCCCCCEECCCCCCCEE IGPNTQATGTASTALGAGTQAQGAQSLALGAGAVTRQVNSIALGASSVTTVGAQGSYSAY ECCCCCCCCCCHHHHCCCCCCCCCCHHHHCCHHHHHHHHHEEECCCCEEEECCCCCCCCC GLPTTQASVGEVGIGTAQGNRKITGVAAGSAGYDAVNVTQLTAVGNKVDQNTADITSLDG CCCCCCCCCCCCEEEECCCCEEEEEEECCCCCCCEEEEEEEEECCCCCCCCCCCEEECCC RVTNVEGGMTSITNGGGIKYFHTHSTEPDSVASGSDSVAIGPNAQASGTTSIAMGAGSTA EEEEECCCCEEECCCCCEEEEECCCCCCCCCCCCCCCEEECCCCCCCCCEEEEECCCCCC QGAQSLALGAGAAASQANSIALGASSVTTVGAESNYSAYGLTASQTSVGEVGVGTAQGNR CCCHHHEECCCCCCCCCCEEEECCCCEEEECCCCCCCEEEEECCCCCCCCCCCEECCCCE KITGVAAGSADYDAVNVAQLTAVGDKVDQNTADITSLDGRVTNVEGEMTSITNGGGVKYF EEEEEECCCCCCCCEEEEEEEECCCCCCCCCCCEEECCCEEEECCCCEEEECCCCCEEEE HTHSTEPDSVASGSDSVAIGPNAQASGTASVASGKDTLASGNGAVAIGDAASVSAEGSVA ECCCCCCCCCCCCCCCEEECCCCCCCCCEEECCCCCCEECCCCCEEECCCCCCCCCCCEE LGQGSADNGRGAESYTGKYSTADNTTSGTVSVGNAATGETRTVSNVADGREAMDAVNLRQ ECCCCCCCCCCCCCCCCCCCCCCCCCCCEEEECCCCCCCCEEHHHHHCCHHHHHHHHHHH LDGAMAAVGDTVSGLQNGTDGMFQVNNNSGQAKPSATGTDAMAGGAGSVASGSHSTAMGT HCCHHHHHHHHHHHHCCCCCCEEEEECCCCCCCCCCCCCCHHCCCCCCCCCCCCCCCCCC GSKATAANSTALGANSVADRENSVSVGSVGNERQLTNVAAGTQGTDAVNLDQLNHSMSNV CCCCCCCCCCCCCCCCCCCCCCCEEECCCCCCCCCCEEECCCCCCCCEEHHHHHHHHHHC TNDANAYTDQRYSALKEDLKKQDSTLSAGIAGAMAMASLTQPYTPGASMATIGAASYRGQ CCCCHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHCCCCCCCCCEEEECCHHCCCC SALSVGVSSISDSGRWVSKLQASSNTQGDMGVGVGVGYQW HHHHHHHHHCCCCCHHHHHHHHCCCCCCCCCEEECCCCCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 6.0
TargetDB status: NA
Availability: NA
References: 3043229; 2761389; 2592347; 1548243; 12183532 [H]