Definition Yersinia pestis Nepal516, complete genome.
Accession NC_008149
Length 4,534,590

Click here to switch to the map view.

The map label for this gene is yadA [H]

Identifier: 108812109

GI number: 108812109

Start: 2197057

End: 2199351

Strand: Reverse

Name: yadA [H]

Synonym: YPN_1947

Alternate gene names: 108812109

Gene position: 2199351-2197057 (Counterclockwise)

Preceding gene: 108812110

Following gene: 108812108

Centisome position: 48.5

GC content: 58.08

Gene sequence:

>2295_bases
ATGAAAAGTATCCAAAAGTGTGACTGTAATTATCTGGTCAGATTTGCAGTTTCAGATTCCTTTATCAGAGACAATTCTTT
TCGCAGCTTGCTTGCTATTTTTATGGTGACGATATTTGTGCCAAATACTGCATTTTCTCAACTCTATGTGAACAATGCCA
ATGATCCTGGCTGTTATGTCATTGCTGATGGGGGGTTTACGGGTGTTACTAATAGTGATCAAAATTGTTATACGTTGTCT
TTGAATAATATTAATACCAATGGGGGGCAGCTATTTGTTGGTGGAAAAGGTGGGATCGCTGGGAAGCCTAGCTTTATCGC
CACCCCTTGGACAGGGACATTCACGACGGCCGTTGGCACCAGTAATGTCGCCACAGCATACGGCTTTGTCGTTCAAAGCA
ATGGTGCATTTATCAACGGTGATACCTACGTGAAGGGGGGGTTATTTTTGAACGGTAGGAAAGCCACCAATCTTGCCCCC
GCAACGATTTCATCGACCTCCACCGATGCGGTGGTTGGTAGCCAGCTTTATACGGTGATCCAAGATGGAACCCGCTATTT
CCACGCCAACTCAGTGAACCCGCAAGACTCCGTGCCTGCGGGTCAGGATGCTATTGCTGTCGGGCCGGCGACGGTGGTCA
ATGGTAATAACGGGATTGGTATTGGTAGTAGCGCCGTTGTTGGGCCGAGTGCTGTCGGGGGCATTGCAATTGGCCCCAAC
ACTCAGGCGACCGGTATCGCCAGCACGGCCCTTGGTGCCGGGTCGCAAGCGCATGGATCACAGTCTTTGGCATTGGGGGC
GGGAGCAACTGCCAGCCAGGCAAACAGTATCGCGTTAGGGGCGTCGTCGGTCACCACGGTCGGTGCTGAGAGCGACTACA
GTGCGTACGGACTGACGGCTCCCCAAACGTCGGTGGGCGAGGTGGGGATGGGCACGGCACAGGGGAATCGCAAGATCACC
GGTGTGGCAGCCGGTTCGGCTGATTATGATGTGGTCAATGTCGCGCAATTGACCGCTGTTGGTGACAAGGTCGAGCAGAA
TACCGCCGACATTACCAGTTTGGGTGGCCGGGTCACCAATGTTGAGGGGGGGATGACCCGTATCACCAACGGGGGCGGTA
TAAAGTACTTCCACACTCACTCCACCGAGCCTGATTCGGTGGCCAGCGGCAGTGATTCGGTGGCGATCGGACCGAATGCG
CAGGCGTCCGGTACCACGTCGATAGCCATGGGGGCCGGGTCGACAGCGCAGGGAGCACAGTCTCTGGCATTGGGGGCGGG
AGCGGCTGCCAGCCAGGCAAACAGTATTGCATTAGGGGCGTCGTCGGTCACCACGGTCGGTGCTGAGAGCGACTACAGTG
CGTACGGACTGACAGCTCCCCAAACGTCGGTGGGCGAGGTGGGGGTGGGCACGGCACAGGGGAATCGCAAGATCACCGGT
GTGGCAGCCGGTTCGGCTGATTATGATGCGGTCAATGTCGCGCAATTGACCGCTGTTGGTGACAAGGTCGATCAGAATAC
CGCTGACATCACCAGCTTAGACGGCCGGGTCACCAATGTTGAGGGGGAGATGGCCAGCATCACCAACGGGGGCGGCGTGA
AATACTTCCACACCCACTCCACCGAGTCTGACTCGGTGGCCAGCGGCAGTGATTCGGTGGCGATCGGACCGAATGCGCAG
GCGTCAGGTACGGCTTCGGTGGCCTCCGGCAAGGGTACGCTGGCCTCCGGTAACGGTGCGGTGGCGATAGGTGATGCAGC
AAGCGTCAGCGCAGAGGGCAGTGTTGCCCTGGGGCAGGGTTCCGCTGACAACGGGCGCGGTGCAGAGAGCTACACCGGCA
AGTACTCCACTACGGATAACACCACCTCAGGTACGGTGTCGGTGGGCAATGCGGCAACCGGAGAGACCCGGACGGTCAGC
AACGTTGCCGACGGGCGAGAGGCCATGGATGCAGTCAATCTGCGGCAACTCGATGGTGCAATGGCGGCGGTGGGTGACAC
CGTATCAGGGTTGCAGAACGGCACTGACGGGATGTTCCAGGTGAACAACAACAGCGGTCAGGCCAAGCCTTCGGTCACCG
GAACTGATGCGATGGCGGGGGGGGGGCAGGCTCCGTGGCGTCTGGCAGCCACAGTACCGCGATGGGTACGGGCAGCAAGG
CGACGGCGGCAAACAGCACCGCGCTGGGGGCCAACTCAGTGGCGGATCGTGAAAACAGTGTCTCGGTGGGGTCAGTGGGT
AATGAACGGCAGCTCACTAATATTGCTGTGGGGACTCAGGGCACTGATGCGGTGA

Upstream 100 bases:

>100_bases
CTTCGATTCACTCAGTGCCATACAGGAGCGGGTTTGAACGTCTTTGCTTAATAATTTGTCACCAATGTCAAAAGGTGAAC
AAGAATAAAATGGGGATGGT

Downstream 100 bases:

>100_bases
ATCTGGATCAACTCAACCATAGCATGTCGAATGTCACCAACGACGCCAATGCTTATACAGACCAGCGCTATTCTGCACTT
AAAGAAGATCTGAAAAAACA

Product: hypothetical protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 764; Mature: 764

Protein sequence:

>764_residues
MKSIQKCDCNYLVRFAVSDSFIRDNSFRSLLAIFMVTIFVPNTAFSQLYVNNANDPGCYVIADGGFTGVTNSDQNCYTLS
LNNINTNGGQLFVGGKGGIAGKPSFIATPWTGTFTTAVGTSNVATAYGFVVQSNGAFINGDTYVKGGLFLNGRKATNLAP
ATISSTSTDAVVGSQLYTVIQDGTRYFHANSVNPQDSVPAGQDAIAVGPATVVNGNNGIGIGSSAVVGPSAVGGIAIGPN
TQATGIASTALGAGSQAHGSQSLALGAGATASQANSIALGASSVTTVGAESDYSAYGLTAPQTSVGEVGMGTAQGNRKIT
GVAAGSADYDVVNVAQLTAVGDKVEQNTADITSLGGRVTNVEGGMTRITNGGGIKYFHTHSTEPDSVASGSDSVAIGPNA
QASGTTSIAMGAGSTAQGAQSLALGAGAAASQANSIALGASSVTTVGAESDYSAYGLTAPQTSVGEVGVGTAQGNRKITG
VAAGSADYDAVNVAQLTAVGDKVDQNTADITSLDGRVTNVEGEMASITNGGGVKYFHTHSTESDSVASGSDSVAIGPNAQ
ASGTASVASGKGTLASGNGAVAIGDAASVSAEGSVALGQGSADNGRGAESYTGKYSTTDNTTSGTVSVGNAATGETRTVS
NVADGREAMDAVNLRQLDGAMAAVGDTVSGLQNGTDGMFQVNNNSGQAKPSVTGTDAMAGGGQAPWRLAATVPRWVRAAR
RRRQTAPRWGPTQWRIVKTVSRWGQWVMNGSSLILLWGLRALMR

Sequences:

>Translated_764_residues
MKSIQKCDCNYLVRFAVSDSFIRDNSFRSLLAIFMVTIFVPNTAFSQLYVNNANDPGCYVIADGGFTGVTNSDQNCYTLS
LNNINTNGGQLFVGGKGGIAGKPSFIATPWTGTFTTAVGTSNVATAYGFVVQSNGAFINGDTYVKGGLFLNGRKATNLAP
ATISSTSTDAVVGSQLYTVIQDGTRYFHANSVNPQDSVPAGQDAIAVGPATVVNGNNGIGIGSSAVVGPSAVGGIAIGPN
TQATGIASTALGAGSQAHGSQSLALGAGATASQANSIALGASSVTTVGAESDYSAYGLTAPQTSVGEVGMGTAQGNRKIT
GVAAGSADYDVVNVAQLTAVGDKVEQNTADITSLGGRVTNVEGGMTRITNGGGIKYFHTHSTEPDSVASGSDSVAIGPNA
QASGTTSIAMGAGSTAQGAQSLALGAGAAASQANSIALGASSVTTVGAESDYSAYGLTAPQTSVGEVGVGTAQGNRKITG
VAAGSADYDAVNVAQLTAVGDKVDQNTADITSLDGRVTNVEGEMASITNGGGVKYFHTHSTESDSVASGSDSVAIGPNAQ
ASGTASVASGKGTLASGNGAVAIGDAASVSAEGSVALGQGSADNGRGAESYTGKYSTTDNTTSGTVSVGNAATGETRTVS
NVADGREAMDAVNLRQLDGAMAAVGDTVSGLQNGTDGMFQVNNNSGQAKPSVTGTDAMAGGGQAPWRLAATVPRWVRAAR
RRRQTAPRWGPTQWRIVKTVSRWGQWVMNGSSLILLWGLRALMR
>Mature_764_residues
MKSIQKCDCNYLVRFAVSDSFIRDNSFRSLLAIFMVTIFVPNTAFSQLYVNNANDPGCYVIADGGFTGVTNSDQNCYTLS
LNNINTNGGQLFVGGKGGIAGKPSFIATPWTGTFTTAVGTSNVATAYGFVVQSNGAFINGDTYVKGGLFLNGRKATNLAP
ATISSTSTDAVVGSQLYTVIQDGTRYFHANSVNPQDSVPAGQDAIAVGPATVVNGNNGIGIGSSAVVGPSAVGGIAIGPN
TQATGIASTALGAGSQAHGSQSLALGAGATASQANSIALGASSVTTVGAESDYSAYGLTAPQTSVGEVGMGTAQGNRKIT
GVAAGSADYDVVNVAQLTAVGDKVEQNTADITSLGGRVTNVEGGMTRITNGGGIKYFHTHSTEPDSVASGSDSVAIGPNA
QASGTTSIAMGAGSTAQGAQSLALGAGAAASQANSIALGASSVTTVGAESDYSAYGLTAPQTSVGEVGVGTAQGNRKITG
VAAGSADYDAVNVAQLTAVGDKVDQNTADITSLDGRVTNVEGEMASITNGGGVKYFHTHSTESDSVASGSDSVAIGPNAQ
ASGTASVASGKGTLASGNGAVAIGDAASVSAEGSVALGQGSADNGRGAESYTGKYSTTDNTTSGTVSVGNAATGETRTVS
NVADGREAMDAVNLRQLDGAMAAVGDTVSGLQNGTDGMFQVNNNSGQAKPSVTGTDAMAGGGQAPWRLAATVPRWVRAAR
RRRQTAPRWGPTQWRIVKTVSRWGQWVMNGSSLILLWGLRALMR

Specific function: Collagen-binding outer membrane protein forming a fibrillar matrix on the bacterial cell surface. Promotes initial attachment and invasion of eukaryotic cells. Also protects the bacteria by being responsible for agglutination, serum resistance, complement

COG id: COG5295

COG function: function code UW; Autotransporter adhesin

Gene ontology:

Cell location: Cell outer membrane [H]

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Belongs to the autotransporter-2 (TC 1.B.40) / oligomeric coiled-coil adhesin (Oca) family [H]

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR008640
- InterPro:   IPR008635
- InterPro:   IPR008126
- InterPro:   IPR005594 [H]

Pfam domain/function: PF05658 Hep_Hag; PF05662 HIM; PF03895 YadA [H]

EC number: NA

Molecular weight: Translated: 76283; Mature: 76283

Theoretical pI: Translated: 5.28; Mature: 5.28

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.5 %Cys     (Translated Protein)
1.6 %Met     (Translated Protein)
2.1 %Cys+Met (Translated Protein)
0.5 %Cys     (Mature Protein)
1.6 %Met     (Mature Protein)
2.1 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKSIQKCDCNYLVRFAVSDSFIRDNSFRSLLAIFMVTIFVPNTAFSQLYVNNANDPGCYV
CCCCHHCCCCEEEEEEECCCHHCCCHHHHHHHHHHHHHHCCCCCEEEEEEECCCCCCEEE
IADGGFTGVTNSDQNCYTLSLNNINTNGGQLFVGGKGGIAGKPSFIATPWTGTFTTAVGT
EECCCEECCCCCCCCEEEEEECCCCCCCCEEEECCCCCCCCCCCEEECCCCCCEEEECCC
SNVATAYGFVVQSNGAFINGDTYVKGGLFLNGRKATNLAPATISSTSTDAVVGSQLYTVI
CCCEEEEEEEEECCCCEECCCEEEECCEEECCCCCCCCCCCEECCCCCCHHHHHHHHHEE
QDGTRYFHANSVNPQDSVPAGQDAIAVGPATVVNGNNGIGIGSSAVVGPSAVGGIAIGPN
CCCCEEEEECCCCCCCCCCCCCCEEEECCEEEEECCCCCCCCCCCEECCCCCCCEEECCC
TQATGIASTALGAGSQAHGSQSLALGAGATASQANSIALGASSVTTVGAESDYSAYGLTA
CCCCCCHHHHCCCCCCCCCCCEEEEECCCCCCCCCEEEECCCCEEEECCCCCCCEEECCC
PQTSVGEVGMGTAQGNRKITGVAAGSADYDVVNVAQLTAVGDKVEQNTADITSLGGRVTN
CCCCCCCCCCCCCCCCEEEEEEECCCCCCCEEEHHHHHHHCCHHHCCCHHHHHCCCEEEE
VEGGMTRITNGGGIKYFHTHSTEPDSVASGSDSVAIGPNAQASGTTSIAMGAGSTAQGAQ
CCCCEEEEECCCCEEEEECCCCCCCCCCCCCCCEEECCCCCCCCCEEEEECCCCCCCCCH
SLALGAGAAASQANSIALGASSVTTVGAESDYSAYGLTAPQTSVGEVGVGTAQGNRKITG
HHEECCCCCCCCCCEEEECCCCEEEECCCCCCCEEECCCCCCCCCCCCCEECCCCEEEEE
VAAGSADYDAVNVAQLTAVGDKVDQNTADITSLDGRVTNVEGEMASITNGGGVKYFHTHS
EECCCCCCCCEEEEEEEECCCCCCCCCCCEEECCCEEEECCCCEEEECCCCCEEEEEECC
TESDSVASGSDSVAIGPNAQASGTASVASGKGTLASGNGAVAIGDAASVSAEGSVALGQG
CCCCCCCCCCCCEEECCCCCCCCCEEEECCCCEEECCCCCEEECCCCCCCCCCCEEECCC
SADNGRGAESYTGKYSTTDNTTSGTVSVGNAATGETRTVSNVADGREAMDAVNLRQLDGA
CCCCCCCCCCCCCCCCCCCCCCCCEEEECCCCCCCCEEHHHHHCCHHHHHHHHHHHHCCH
MAAVGDTVSGLQNGTDGMFQVNNNSGQAKPSVTGTDAMAGGGQAPWRLAATVPRWVRAAR
HHHHHHHHHHHCCCCCCEEEEECCCCCCCCCCCCCCCCCCCCCCCEEEEHHHHHHHHHHH
RRRQTAPRWGPTQWRIVKTVSRWGQWVMNGSSLILLWGLRALMR
HHHHCCCCCCCCHHHHHHHHHHHHHHEECCCCEEEEEHHHHHHC
>Mature Secondary Structure
MKSIQKCDCNYLVRFAVSDSFIRDNSFRSLLAIFMVTIFVPNTAFSQLYVNNANDPGCYV
CCCCHHCCCCEEEEEEECCCHHCCCHHHHHHHHHHHHHHCCCCCEEEEEEECCCCCCEEE
IADGGFTGVTNSDQNCYTLSLNNINTNGGQLFVGGKGGIAGKPSFIATPWTGTFTTAVGT
EECCCEECCCCCCCCEEEEEECCCCCCCCEEEECCCCCCCCCCCEEECCCCCCEEEECCC
SNVATAYGFVVQSNGAFINGDTYVKGGLFLNGRKATNLAPATISSTSTDAVVGSQLYTVI
CCCEEEEEEEEECCCCEECCCEEEECCEEECCCCCCCCCCCEECCCCCCHHHHHHHHHEE
QDGTRYFHANSVNPQDSVPAGQDAIAVGPATVVNGNNGIGIGSSAVVGPSAVGGIAIGPN
CCCCEEEEECCCCCCCCCCCCCCEEEECCEEEEECCCCCCCCCCCEECCCCCCCEEECCC
TQATGIASTALGAGSQAHGSQSLALGAGATASQANSIALGASSVTTVGAESDYSAYGLTA
CCCCCCHHHHCCCCCCCCCCCEEEEECCCCCCCCCEEEECCCCEEEECCCCCCCEEECCC
PQTSVGEVGMGTAQGNRKITGVAAGSADYDVVNVAQLTAVGDKVEQNTADITSLGGRVTN
CCCCCCCCCCCCCCCCEEEEEEECCCCCCCEEEHHHHHHHCCHHHCCCHHHHHCCCEEEE
VEGGMTRITNGGGIKYFHTHSTEPDSVASGSDSVAIGPNAQASGTTSIAMGAGSTAQGAQ
CCCCEEEEECCCCEEEEECCCCCCCCCCCCCCCEEECCCCCCCCCEEEEECCCCCCCCCH
SLALGAGAAASQANSIALGASSVTTVGAESDYSAYGLTAPQTSVGEVGVGTAQGNRKITG
HHEECCCCCCCCCCEEEECCCCEEEECCCCCCCEEECCCCCCCCCCCCCEECCCCEEEEE
VAAGSADYDAVNVAQLTAVGDKVDQNTADITSLDGRVTNVEGEMASITNGGGVKYFHTHS
EECCCCCCCCEEEEEEEECCCCCCCCCCCEEECCCEEEECCCCEEEECCCCCEEEEEECC
TESDSVASGSDSVAIGPNAQASGTASVASGKGTLASGNGAVAIGDAASVSAEGSVALGQG
CCCCCCCCCCCCEEECCCCCCCCCEEEECCCCEEECCCCCEEECCCCCCCCCCCEEECCC
SADNGRGAESYTGKYSTTDNTTSGTVSVGNAATGETRTVSNVADGREAMDAVNLRQLDGA
CCCCCCCCCCCCCCCCCCCCCCCCEEEECCCCCCCCEEHHHHHCCHHHHHHHHHHHHCCH
MAAVGDTVSGLQNGTDGMFQVNNNSGQAKPSVTGTDAMAGGGQAPWRLAATVPRWVRAAR
HHHHHHHHHHHCCCCCCEEEEECCCCCCCCCCCCCCCCCCCCCCCEEEEHHHHHHHHHHH
RRRQTAPRWGPTQWRIVKTVSRWGQWVMNGSSLILLWGLRALMR
HHHHCCCCCCCCHHHHHHHHHHHHHHEECCCCEEEEEHHHHHHC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 14527656; 2592347 [H]