The gene/protein map for NC_009708 is currently unavailable.
Definition Yersinia pseudotuberculosis IP 31758, complete genome.
Accession NC_009708
Length 4,723,306

Click here to switch to the map view.

The map label for this gene is yadA [H]

Identifier: 153947101

GI number: 153947101

Start: 1919149

End: 1921791

Strand: Direct

Name: yadA [H]

Synonym: YpsIP31758_1650

Alternate gene names: 153947101

Gene position: 1919149-1921791 (Clockwise)

Preceding gene: 153947682

Following gene: 153950540

Centisome position: 40.63

GC content: 57.78

Gene sequence:

>2643_bases
ATGAAAAGTATCCAAAAGTGTGACTGTAATTATCTGGCCAGATTTGCAGTTTCAGATTCCTTTATCAGAGATAATTCTTT
TCGCGGCTTGCTTGCTATTTTTATGGTGACGATATTTGTGCCAGGTACTGCATTTTCTGAACTCTATGTGAACAATGCCA
ATGATCCTGGCTGTTATGCCGTTGTGGATGATAATAATCTGAATTTTAAGGGGAGGATCACCGGTATTGTTACTAACCAT
ATATATTGTAATACGTTGACTGAGGCGAATCTGAATACCAATGGGGGGCAGCTATTTGTTGGCGGACAAGGCGGGCTCCC
AGGGTACGCTCCCACCCCCTGGACAGGGACATTCACGACGGCCGTTGGCACCAGTAATGTCGCCACAGCATACGGCTTTG
TCGTTCAAAAAAATGGTGCATTTATCAACGGTGATACCTACGTGCAGGGGGGGTTATTTTTGAATGGTAGGAAAGCCACC
AATCTTGCCCCCGCAACGATTTCATCGACCTCCACCGATGCGGTGGTTGGTAGCCAGCTTTATACGGTGATCCAAGATGG
AACCCGCTATTTCCACGCCAACTCAGCGAACCCGCAAGACTCCGTGCCTACGGGTCAGGATGCTATTGCTGTCGGGCCGG
CGACGGTGGTCAATGGTAATAACGGGATTGGTATTGGTAATAGCGCCGTTGTTGGGCCGAGTGCTGTCGGGGGCATTGCA
ATTGGCCCCAACACTCAGGCGACCGGTACCGCCAGCACGGCCCTTGGTGCCGGAACGCAGGCGCAGGGGGCACAGTCTTT
GGCTCTTGGGGCCGGGGCGGTTACCCGCCAGGTAAACAGTATTGCGTTAGGGGCGTCGTCGGTCACCACGGTGGGCGCTC
AGGGCAGCTACAGTGCATACGGACTGCCGACCACGCAGGCGTCGGTGGGGGAAGTGGGCATAGGGACCGCGCAGGGTAAT
CGCAAGATCACCGGTGTGGCAGCGGGCTCGGCTGGTTATGATGCGGTCAACGTGACTCAGTTGACTGCTGTTGGTAATAA
AGTCGACCAAAATACCGCTGACATTACCAGTTTAGACGGCCGGGTCACCAATGTTGAGGGGGGGATGACCAGCATCACCA
ACGGGGGCGGTATAAAGTACTTCCACACTCACTCCACCGAGCCTGATTCGGTGGCCAGCGGCAGTGATTCGGTGGCGATC
GGACCGAATGCGCAGGCGTCCGGTACCACGTCGATAGCCATGGGGGCCGGGTCGACAGCGCAGGGAGCACAGTCTCTGGC
ATTGGGGGCGGGAGCGGCTGCCAGCCAGGCAAACAGTATTGCGTTAGGGGCGTCATCGGTCACCACGGTCGGTGCTGAGA
GCAACTACAGTGCGTACGGACTGACAGCTTCCCAAACGTCGGTGGGCGAGGTGGGGGTGGGCACGGCACAGGGGAATCGC
AAGATCACCGGTGTGGCAGCCGGTTCGGCTGATTATGATGCGGTCAATGTCGCGCAATTGACCGCTGTTGGTGACAAGGT
CGATCAGAATACCGCTGACATCACCAGTTTAGACGGCCGGGTCACCAATGTTGAGGGGGAGATGACCAGCATCACCAACG
GGGGCGGCGTGAAATACTTCCACACCCACTCCACCGAGCCTGATTCGGTGGCCAGCGGCAGTGATTCGGTGGCGATCGGA
CCGAATGCGCAGGCGTCAGGTACGGCTTCGGTGGCCTCCGGCAAGGATACGCTGGCCTCCGGTAACGGTGCGGTGGCGAT
AGGTGATGCAGCAAGCGTCAGCGCAGAGGGCAGTGTTGCCCTGGGGCAGGGTTCCGCTGACAACGGGCGCGGTGCAGAGA
GCTACACCGGCAAGTACTCCACTGCGGATAACACCACCTCAGGTACGGTGTCGGTGGGCAATGCGGCAACCGGAGAGACC
CGGACGGTCAGCAACGTTGCCGACGGGCGAGAGGCCATGGATGCAGTCAATCTGCGGCAACTCGATGGTGCAATGGCGGC
GGTGGGTGACACCGTATCAGGGTTGCAGAACGGCACTGACGGGATGTTCCAGGTGAACAACAACAGCGGTCAGGCCAAGC
CTTCGGCCACCGGAACTGATGCGATGGCGGGGGGGGCAGGTTCCGTGGCGTCTGGCAGCCACAGTACCGCGATGGGTACG
GGCAGCAAGGCGACGGCGGCAAACAGCACCGCGCTGGGGGCCAACTCAGTGGCGGATCGTGAAAACAGTGTCTCGGTGGG
GTCAGTGGGTAATGAACGGCAGCTCACTAATGTTGCTGCGGGGACTCAGGGCACTGATGCGGTGAATCTGGATCAACTCA
ACCATAGCATGTCGAATGTCACCAACGACGCCAATGCTTATACAGACCAGCGCTATTCTGCACTTAAAGAAGATCTGAAA
AAACAGGATAGTACGTTAAGTGCGGGGATCGCCGGTGCCATGGCGATGGCGAGCCTGACTCAACCCTATACGCCGGGTGC
CAGCATGGCGACCATTGGTGCGGCCAGCTATCGGGGCCAGTCGGCGCTGTCGGTGGGGGTGTCGAGTATTTCTGACAGTG
GGCGATGGGTCAGCAAATTGCAGGCCTCCTCTAATACACAAGGCGATATGGGGGTTGGTGTCGGCGTCGGTTATCAATGG
TAA

Upstream 100 bases:

>100_bases
CTTCGATTCACTCAGTGCCATACAGGAGCGGGTTTGAACGTCTTTGCTTAATAATTTGTCACCAATGTCAAAAGGTGAAC
AAGAATAAAATGGGGATGGT

Downstream 100 bases:

>100_bases
AGAAAGGCCAACACTGAATATTGTTTAATAATCATTAACGGGTTGTGCGATTTTTTGCACAGCCCGATTCTACTTCTTAG
GGATTAAAAGGCAGCACCCA

Product: hemagglutination repeat-containing protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 880; Mature: 880

Protein sequence:

>880_residues
MKSIQKCDCNYLARFAVSDSFIRDNSFRGLLAIFMVTIFVPGTAFSELYVNNANDPGCYAVVDDNNLNFKGRITGIVTNH
IYCNTLTEANLNTNGGQLFVGGQGGLPGYAPTPWTGTFTTAVGTSNVATAYGFVVQKNGAFINGDTYVQGGLFLNGRKAT
NLAPATISSTSTDAVVGSQLYTVIQDGTRYFHANSANPQDSVPTGQDAIAVGPATVVNGNNGIGIGNSAVVGPSAVGGIA
IGPNTQATGTASTALGAGTQAQGAQSLALGAGAVTRQVNSIALGASSVTTVGAQGSYSAYGLPTTQASVGEVGIGTAQGN
RKITGVAAGSAGYDAVNVTQLTAVGNKVDQNTADITSLDGRVTNVEGGMTSITNGGGIKYFHTHSTEPDSVASGSDSVAI
GPNAQASGTTSIAMGAGSTAQGAQSLALGAGAAASQANSIALGASSVTTVGAESNYSAYGLTASQTSVGEVGVGTAQGNR
KITGVAAGSADYDAVNVAQLTAVGDKVDQNTADITSLDGRVTNVEGEMTSITNGGGVKYFHTHSTEPDSVASGSDSVAIG
PNAQASGTASVASGKDTLASGNGAVAIGDAASVSAEGSVALGQGSADNGRGAESYTGKYSTADNTTSGTVSVGNAATGET
RTVSNVADGREAMDAVNLRQLDGAMAAVGDTVSGLQNGTDGMFQVNNNSGQAKPSATGTDAMAGGAGSVASGSHSTAMGT
GSKATAANSTALGANSVADRENSVSVGSVGNERQLTNVAAGTQGTDAVNLDQLNHSMSNVTNDANAYTDQRYSALKEDLK
KQDSTLSAGIAGAMAMASLTQPYTPGASMATIGAASYRGQSALSVGVSSISDSGRWVSKLQASSNTQGDMGVGVGVGYQW

Sequences:

>Translated_880_residues
MKSIQKCDCNYLARFAVSDSFIRDNSFRGLLAIFMVTIFVPGTAFSELYVNNANDPGCYAVVDDNNLNFKGRITGIVTNH
IYCNTLTEANLNTNGGQLFVGGQGGLPGYAPTPWTGTFTTAVGTSNVATAYGFVVQKNGAFINGDTYVQGGLFLNGRKAT
NLAPATISSTSTDAVVGSQLYTVIQDGTRYFHANSANPQDSVPTGQDAIAVGPATVVNGNNGIGIGNSAVVGPSAVGGIA
IGPNTQATGTASTALGAGTQAQGAQSLALGAGAVTRQVNSIALGASSVTTVGAQGSYSAYGLPTTQASVGEVGIGTAQGN
RKITGVAAGSAGYDAVNVTQLTAVGNKVDQNTADITSLDGRVTNVEGGMTSITNGGGIKYFHTHSTEPDSVASGSDSVAI
GPNAQASGTTSIAMGAGSTAQGAQSLALGAGAAASQANSIALGASSVTTVGAESNYSAYGLTASQTSVGEVGVGTAQGNR
KITGVAAGSADYDAVNVAQLTAVGDKVDQNTADITSLDGRVTNVEGEMTSITNGGGVKYFHTHSTEPDSVASGSDSVAIG
PNAQASGTASVASGKDTLASGNGAVAIGDAASVSAEGSVALGQGSADNGRGAESYTGKYSTADNTTSGTVSVGNAATGET
RTVSNVADGREAMDAVNLRQLDGAMAAVGDTVSGLQNGTDGMFQVNNNSGQAKPSATGTDAMAGGAGSVASGSHSTAMGT
GSKATAANSTALGANSVADRENSVSVGSVGNERQLTNVAAGTQGTDAVNLDQLNHSMSNVTNDANAYTDQRYSALKEDLK
KQDSTLSAGIAGAMAMASLTQPYTPGASMATIGAASYRGQSALSVGVSSISDSGRWVSKLQASSNTQGDMGVGVGVGYQW
>Mature_880_residues
MKSIQKCDCNYLARFAVSDSFIRDNSFRGLLAIFMVTIFVPGTAFSELYVNNANDPGCYAVVDDNNLNFKGRITGIVTNH
IYCNTLTEANLNTNGGQLFVGGQGGLPGYAPTPWTGTFTTAVGTSNVATAYGFVVQKNGAFINGDTYVQGGLFLNGRKAT
NLAPATISSTSTDAVVGSQLYTVIQDGTRYFHANSANPQDSVPTGQDAIAVGPATVVNGNNGIGIGNSAVVGPSAVGGIA
IGPNTQATGTASTALGAGTQAQGAQSLALGAGAVTRQVNSIALGASSVTTVGAQGSYSAYGLPTTQASVGEVGIGTAQGN
RKITGVAAGSAGYDAVNVTQLTAVGNKVDQNTADITSLDGRVTNVEGGMTSITNGGGIKYFHTHSTEPDSVASGSDSVAI
GPNAQASGTTSIAMGAGSTAQGAQSLALGAGAAASQANSIALGASSVTTVGAESNYSAYGLTASQTSVGEVGVGTAQGNR
KITGVAAGSADYDAVNVAQLTAVGDKVDQNTADITSLDGRVTNVEGEMTSITNGGGVKYFHTHSTEPDSVASGSDSVAIG
PNAQASGTASVASGKDTLASGNGAVAIGDAASVSAEGSVALGQGSADNGRGAESYTGKYSTADNTTSGTVSVGNAATGET
RTVSNVADGREAMDAVNLRQLDGAMAAVGDTVSGLQNGTDGMFQVNNNSGQAKPSATGTDAMAGGAGSVASGSHSTAMGT
GSKATAANSTALGANSVADRENSVSVGSVGNERQLTNVAAGTQGTDAVNLDQLNHSMSNVTNDANAYTDQRYSALKEDLK
KQDSTLSAGIAGAMAMASLTQPYTPGASMATIGAASYRGQSALSVGVSSISDSGRWVSKLQASSNTQGDMGVGVGVGYQW

Specific function: Collagen-binding outer membrane protein forming a fibrillar matrix on the bacterial cell surface. Promotes attachment to eukaryotic cells and after invasion, is the major adhesin in infected tissue. Constitutes an alternative uptake pathway under conditio

COG id: COG5295

COG function: function code UW; Autotransporter adhesin

Gene ontology:

Cell location: Cell outer membrane [H]

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Belongs to the autotransporter-2 (TC 1.B.40) / oligomeric coiled-coil adhesin (Oca) family [H]

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR008640
- InterPro:   IPR008635
- InterPro:   IPR008126
- InterPro:   IPR005594 [H]

Pfam domain/function: PF05658 Hep_Hag; PF05662 HIM; PF03895 YadA [H]

EC number: NA

Molecular weight: Translated: 86906; Mature: 86906

Theoretical pI: Translated: 4.49; Mature: 4.49

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.5 %Cys     (Translated Protein)
1.7 %Met     (Translated Protein)
2.2 %Cys+Met (Translated Protein)
0.5 %Cys     (Mature Protein)
1.7 %Met     (Mature Protein)
2.2 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKSIQKCDCNYLARFAVSDSFIRDNSFRGLLAIFMVTIFVPGTAFSELYVNNANDPGCYA
CCCHHHCCHHHHHHHHHCCCHHCCCCCHHHHHHHHHHHHCCCCCEEEEEEECCCCCCEEE
VVDDNNLNFKGRITGIVTNHIYCNTLTEANLNTNGGQLFVGGQGGLPGYAPTPWTGTFTT
EECCCCCCEEEEEEEEEECEEEEEEEEECCCCCCCCEEEECCCCCCCCCCCCCCCCEEEE
AVGTSNVATAYGFVVQKNGAFINGDTYVQGGLFLNGRKATNLAPATISSTSTDAVVGSQL
ECCCCCCCEEEEEEEECCCCEECCCEEEECCEEECCCCCCCCCCCEECCCCCCHHHHHHH
YTVIQDGTRYFHANSANPQDSVPTGQDAIAVGPATVVNGNNGIGIGNSAVVGPSAVGGIA
HHHHHCCCEEEECCCCCCCCCCCCCCCEEEECCEEEEECCCCCCCCCCCEECCCCCCCEE
IGPNTQATGTASTALGAGTQAQGAQSLALGAGAVTRQVNSIALGASSVTTVGAQGSYSAY
ECCCCCCCCCCHHHHCCCCCCCCCCHHHHCCHHHHHHHHHEEECCCCEEEECCCCCCCCC
GLPTTQASVGEVGIGTAQGNRKITGVAAGSAGYDAVNVTQLTAVGNKVDQNTADITSLDG
CCCCCCCCCCCCEEEECCCCEEEEEEECCCCCCCEEEEEEEEECCCCCCCCCCCEEECCC
RVTNVEGGMTSITNGGGIKYFHTHSTEPDSVASGSDSVAIGPNAQASGTTSIAMGAGSTA
EEEEECCCCEEECCCCCEEEEECCCCCCCCCCCCCCCEEECCCCCCCCCEEEEECCCCCC
QGAQSLALGAGAAASQANSIALGASSVTTVGAESNYSAYGLTASQTSVGEVGVGTAQGNR
CCCHHHEECCCCCCCCCCEEEECCCCEEEECCCCCCCEEEEECCCCCCCCCCCEECCCCE
KITGVAAGSADYDAVNVAQLTAVGDKVDQNTADITSLDGRVTNVEGEMTSITNGGGVKYF
EEEEEECCCCCCCCEEEEEEEECCCCCCCCCCCEEECCCEEEECCCCEEEECCCCCEEEE
HTHSTEPDSVASGSDSVAIGPNAQASGTASVASGKDTLASGNGAVAIGDAASVSAEGSVA
ECCCCCCCCCCCCCCCEEECCCCCCCCCEEECCCCCCEECCCCCEEECCCCCCCCCCCEE
LGQGSADNGRGAESYTGKYSTADNTTSGTVSVGNAATGETRTVSNVADGREAMDAVNLRQ
ECCCCCCCCCCCCCCCCCCCCCCCCCCCEEEECCCCCCCCEEHHHHHCCHHHHHHHHHHH
LDGAMAAVGDTVSGLQNGTDGMFQVNNNSGQAKPSATGTDAMAGGAGSVASGSHSTAMGT
HCCHHHHHHHHHHHHCCCCCCEEEEECCCCCCCCCCCCCCHHCCCCCCCCCCCCCCCCCC
GSKATAANSTALGANSVADRENSVSVGSVGNERQLTNVAAGTQGTDAVNLDQLNHSMSNV
CCCCCCCCCCCCCCCCCCCCCCCEEECCCCCCCCCCEEECCCCCCCCEEHHHHHHHHHHC
TNDANAYTDQRYSALKEDLKKQDSTLSAGIAGAMAMASLTQPYTPGASMATIGAASYRGQ
CCCCHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHCCCCCCCCCEEEECCHHCCCC
SALSVGVSSISDSGRWVSKLQASSNTQGDMGVGVGVGYQW
HHHHHHHHHCCCCCHHHHHHHHCCCCCCCCCEEECCCCCC
>Mature Secondary Structure
MKSIQKCDCNYLARFAVSDSFIRDNSFRGLLAIFMVTIFVPGTAFSELYVNNANDPGCYA
CCCHHHCCHHHHHHHHHCCCHHCCCCCHHHHHHHHHHHHCCCCCEEEEEEECCCCCCEEE
VVDDNNLNFKGRITGIVTNHIYCNTLTEANLNTNGGQLFVGGQGGLPGYAPTPWTGTFTT
EECCCCCCEEEEEEEEEECEEEEEEEEECCCCCCCCEEEECCCCCCCCCCCCCCCCEEEE
AVGTSNVATAYGFVVQKNGAFINGDTYVQGGLFLNGRKATNLAPATISSTSTDAVVGSQL
ECCCCCCCEEEEEEEECCCCEECCCEEEECCEEECCCCCCCCCCCEECCCCCCHHHHHHH
YTVIQDGTRYFHANSANPQDSVPTGQDAIAVGPATVVNGNNGIGIGNSAVVGPSAVGGIA
HHHHHCCCEEEECCCCCCCCCCCCCCCEEEECCEEEEECCCCCCCCCCCEECCCCCCCEE
IGPNTQATGTASTALGAGTQAQGAQSLALGAGAVTRQVNSIALGASSVTTVGAQGSYSAY
ECCCCCCCCCCHHHHCCCCCCCCCCHHHHCCHHHHHHHHHEEECCCCEEEECCCCCCCCC
GLPTTQASVGEVGIGTAQGNRKITGVAAGSAGYDAVNVTQLTAVGNKVDQNTADITSLDG
CCCCCCCCCCCCEEEECCCCEEEEEEECCCCCCCEEEEEEEEECCCCCCCCCCCEEECCC
RVTNVEGGMTSITNGGGIKYFHTHSTEPDSVASGSDSVAIGPNAQASGTTSIAMGAGSTA
EEEEECCCCEEECCCCCEEEEECCCCCCCCCCCCCCCEEECCCCCCCCCEEEEECCCCCC
QGAQSLALGAGAAASQANSIALGASSVTTVGAESNYSAYGLTASQTSVGEVGVGTAQGNR
CCCHHHEECCCCCCCCCCEEEECCCCEEEECCCCCCCEEEEECCCCCCCCCCCEECCCCE
KITGVAAGSADYDAVNVAQLTAVGDKVDQNTADITSLDGRVTNVEGEMTSITNGGGVKYF
EEEEEECCCCCCCCEEEEEEEECCCCCCCCCCCEEECCCEEEECCCCEEEECCCCCEEEE
HTHSTEPDSVASGSDSVAIGPNAQASGTASVASGKDTLASGNGAVAIGDAASVSAEGSVA
ECCCCCCCCCCCCCCCEEECCCCCCCCCEEECCCCCCEECCCCCEEECCCCCCCCCCCEE
LGQGSADNGRGAESYTGKYSTADNTTSGTVSVGNAATGETRTVSNVADGREAMDAVNLRQ
ECCCCCCCCCCCCCCCCCCCCCCCCCCCEEEECCCCCCCCEEHHHHHCCHHHHHHHHHHH
LDGAMAAVGDTVSGLQNGTDGMFQVNNNSGQAKPSATGTDAMAGGAGSVASGSHSTAMGT
HCCHHHHHHHHHHHHCCCCCCEEEEECCCCCCCCCCCCCCHHCCCCCCCCCCCCCCCCCC
GSKATAANSTALGANSVADRENSVSVGSVGNERQLTNVAAGTQGTDAVNLDQLNHSMSNV
CCCCCCCCCCCCCCCCCCCCCCCEEECCCCCCCCCCEEECCCCCCCCEEHHHHHHHHHHC
TNDANAYTDQRYSALKEDLKKQDSTLSAGIAGAMAMASLTQPYTPGASMATIGAASYRGQ
CCCCHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHCCCCCCCCCEEEECCHHCCCC
SALSVGVSSISDSGRWVSKLQASSNTQGDMGVGVGVGYQW
HHHHHHHHHCCCCCHHHHHHHHCCCCCCCCCEEECCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 3043229; 2761389; 2592347; 1548243; 12183532 [H]