Definition Sinorhizobium medicae WSM419 chromosome, complete genome.
Accession NC_009636
Length 3,781,904

Click here to switch to the map view.

The map label for this gene is yadA [H]

Identifier: 150395314

GI number: 150395314

Start: 95969

End: 97768

Strand: Direct

Name: yadA [H]

Synonym: Smed_0086

Alternate gene names: 150395314

Gene position: 95969-97768 (Clockwise)

Preceding gene: 150395313

Following gene: 150395315

Centisome position: 2.54

GC content: 62.56

Gene sequence:

>1800_bases
TTGGTAGTAGCGACTTGCACACGTTCTGTTGATCGCAGGCGAGATCGAGGTGTCTCTTCAAGCTGGTTTCGGCTTGCGCT
GGGGAGACGACGGCTGATTGGGCCGGGTACGGCCGTCTTGCTGGCAGCTGCCGTGGTGACAGGTTCCGCGCCGGCAGTCT
CGGCCGCCACGCTGACCTCGATCTTCGCGACCGAGGCCAACAGAACCGGCGAAAACGGCGCGACCGCCAACTCTGCATGT
GATTCGGAGCTGAGATTTTGCTCCACTGCGATCGGCACTGGTGCCGACGCAAGCGGTGTCGCTTCAACCGCGCTTGCTTC
CGAGGCCGTGGCATCCGGAACGAAAGCAATTGCGATCGGCGGACGCTCGTCAGCGTCCGGGGAGAACAGCATTGCTCTAG
GCACGTCTGCGCAAGCCGCGGGAAGTCAGGCCACCGCCGTCGGTCTGCAATCGAATGCCGGTGGCGGCAATTCGATCGCC
TTGGGCTTTGGGGCGCAGACGAGGGCCGGGGATGCAACGGATCCGGACGGCGCGACCTCAGCCGTAGCGATCGGATCCGG
CGCGCAGGCCAATGGCGAACAATCCCTGAGCTTCGGCTCATTAGCCGAGGCGACCGGTGAAGGAAGCGTCGCCATCGGTC
CGCTCAGCAAAGTGTCGGCCAAAAATGGCGTCGGCATCGGTAACGATAACAAGGTTTCAGGCATCGACAGTGTCGGTATC
GGTACCGGCAATTCGGTGACAGGTGAAAAAAGCGTCGGCATCGGATACGCCAATACCGTCTCGGGCGATAACAGTGGTGC
AATAGGCGACCCGACCACCATTACGGGCACCGGTTCCTATTCTCTCGGCAACGACAACACCATCGACGCCGACAACGCCG
GCACGTTCGGCAACGACAACAAACTGGCGAATACGGCCGATGGCAGCCGCATCGTAGGCAACGGCAACGACATAGATGTC
GGGGACGCTTTCGTGCTCGGCAATACGGCCGACGTCACGGTCGAGGGCGGCGTCGCGCTCGGTACCAGCTCTGTTTCCGA
CACCGGCGCGGTGGACGGCTACGTGCCGTTTGGTGCATCGGAAGCGGACAGAAACGCAATCGCCGAAACGAAAAGCACGA
GCGGCGCCGTGGCAGTGGGCAATGATGCCCCCGGTGCCGAAATCTATCGCCAGATCACGGGGCTTGCCGCCGGTACGGCG
GATTCCGATGCCGTCAATGTCTCACAGCTCAAGGCCCTCGAAGGCGGCGTGAAAAATGCCGTATCCTATGACACCGACGC
CGCCGGCCAGAAGCTCAACACGATCACCTTGAAGGGTGGCGACCCCAACCAGCCGGTTCTCGTGGCCAATGTCGCCAAAG
GCGTAAAGGACACCGATGCCGCCAATGTCGGTCAGGTCAAGGAAGGGATCGCCGAAACCAAGCACTACACGGACGAAAAG
ACCAATTGGGCGATAGATCAGTCGGCCAGCTATACGGATACCGTCACGGACACCAAGGTCCGCGCGGCGAACCACTACAC
GGATCAGAAATTCTCGCAGCTGTCGGGCGAGCTCGGGGAAGTTCGCGGGGAAGCCCGCCAGGCCGCCGCAATCGGCCTCG
CGGCATCCTCCCTGCGTTTCGACGACCGGCCTGGCAAGCTAAGCGTAGCGCTTGGAGGCGGGTTCTGGAGGAGCGAAGCA
GCACTCGCATTCGGCGCCGGCTACACGAGTGAGAACGGCCGCATGCGGGCAAATCTCACCGGAACGGCGGCCGGGGGGCA
CGTCGGCGTTGGCGCGGGGCTCAGCATCACTTTGAACTGA

Upstream 100 bases:

>100_bases
CAGAACGGCTGCTCTTCTCGGGCTTGGGTACCGAACAGGACTTATTCCCGAGCGACGGTGAGCGCTGGAGAGAGCAGGAT
CATTCTTGAAGGAGGTTATC

Downstream 100 bases:

>100_bases
GATGTCCAGGCAACTCGCCACCGTGCTTCCCGTCGCGGCTTGCATGGTCCTGTCCGGCGGCGCTCCCGCCGTCGGGCAGG
GTGCGACGCCGGAACCCCGC

Product: YadA domain-containing protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 599; Mature: 599

Protein sequence:

>599_residues
MVVATCTRSVDRRRDRGVSSSWFRLALGRRRLIGPGTAVLLAAAVVTGSAPAVSAATLTSIFATEANRTGENGATANSAC
DSELRFCSTAIGTGADASGVASTALASEAVASGTKAIAIGGRSSASGENSIALGTSAQAAGSQATAVGLQSNAGGGNSIA
LGFGAQTRAGDATDPDGATSAVAIGSGAQANGEQSLSFGSLAEATGEGSVAIGPLSKVSAKNGVGIGNDNKVSGIDSVGI
GTGNSVTGEKSVGIGYANTVSGDNSGAIGDPTTITGTGSYSLGNDNTIDADNAGTFGNDNKLANTADGSRIVGNGNDIDV
GDAFVLGNTADVTVEGGVALGTSSVSDTGAVDGYVPFGASEADRNAIAETKSTSGAVAVGNDAPGAEIYRQITGLAAGTA
DSDAVNVSQLKALEGGVKNAVSYDTDAAGQKLNTITLKGGDPNQPVLVANVAKGVKDTDAANVGQVKEGIAETKHYTDEK
TNWAIDQSASYTDTVTDTKVRAANHYTDQKFSQLSGELGEVRGEARQAAAIGLAASSLRFDDRPGKLSVALGGGFWRSEA
ALAFGAGYTSENGRMRANLTGTAAGGHVGVGAGLSITLN

Sequences:

>Translated_599_residues
MVVATCTRSVDRRRDRGVSSSWFRLALGRRRLIGPGTAVLLAAAVVTGSAPAVSAATLTSIFATEANRTGENGATANSAC
DSELRFCSTAIGTGADASGVASTALASEAVASGTKAIAIGGRSSASGENSIALGTSAQAAGSQATAVGLQSNAGGGNSIA
LGFGAQTRAGDATDPDGATSAVAIGSGAQANGEQSLSFGSLAEATGEGSVAIGPLSKVSAKNGVGIGNDNKVSGIDSVGI
GTGNSVTGEKSVGIGYANTVSGDNSGAIGDPTTITGTGSYSLGNDNTIDADNAGTFGNDNKLANTADGSRIVGNGNDIDV
GDAFVLGNTADVTVEGGVALGTSSVSDTGAVDGYVPFGASEADRNAIAETKSTSGAVAVGNDAPGAEIYRQITGLAAGTA
DSDAVNVSQLKALEGGVKNAVSYDTDAAGQKLNTITLKGGDPNQPVLVANVAKGVKDTDAANVGQVKEGIAETKHYTDEK
TNWAIDQSASYTDTVTDTKVRAANHYTDQKFSQLSGELGEVRGEARQAAAIGLAASSLRFDDRPGKLSVALGGGFWRSEA
ALAFGAGYTSENGRMRANLTGTAAGGHVGVGAGLSITLN
>Mature_599_residues
MVVATCTRSVDRRRDRGVSSSWFRLALGRRRLIGPGTAVLLAAAVVTGSAPAVSAATLTSIFATEANRTGENGATANSAC
DSELRFCSTAIGTGADASGVASTALASEAVASGTKAIAIGGRSSASGENSIALGTSAQAAGSQATAVGLQSNAGGGNSIA
LGFGAQTRAGDATDPDGATSAVAIGSGAQANGEQSLSFGSLAEATGEGSVAIGPLSKVSAKNGVGIGNDNKVSGIDSVGI
GTGNSVTGEKSVGIGYANTVSGDNSGAIGDPTTITGTGSYSLGNDNTIDADNAGTFGNDNKLANTADGSRIVGNGNDIDV
GDAFVLGNTADVTVEGGVALGTSSVSDTGAVDGYVPFGASEADRNAIAETKSTSGAVAVGNDAPGAEIYRQITGLAAGTA
DSDAVNVSQLKALEGGVKNAVSYDTDAAGQKLNTITLKGGDPNQPVLVANVAKGVKDTDAANVGQVKEGIAETKHYTDEK
TNWAIDQSASYTDTVTDTKVRAANHYTDQKFSQLSGELGEVRGEARQAAAIGLAASSLRFDDRPGKLSVALGGGFWRSEA
ALAFGAGYTSENGRMRANLTGTAAGGHVGVGAGLSITLN

Specific function: Collagen-binding outer membrane protein forming a fibrillar matrix on the bacterial cell surface. Promotes attachment to eukaryotic cells and after invasion, is the major adhesin in infected tissue. Constitutes an alternative uptake pathway under conditio

COG id: COG5295

COG function: function code UW; Autotransporter adhesin

Gene ontology:

Cell location: Cell outer membrane [H]

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Belongs to the autotransporter-2 (TC 1.B.40) / oligomeric coiled-coil adhesin (Oca) family [H]

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR008640
- InterPro:   IPR008635
- InterPro:   IPR008126
- InterPro:   IPR005594 [H]

Pfam domain/function: PF05658 Hep_Hag; PF05662 HIM; PF03895 YadA [H]

EC number: NA

Molecular weight: Translated: 58895; Mature: 58895

Theoretical pI: Translated: 4.50; Mature: 4.50

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.5 %Cys     (Translated Protein)
0.3 %Met     (Translated Protein)
0.8 %Cys+Met (Translated Protein)
0.5 %Cys     (Mature Protein)
0.3 %Met     (Mature Protein)
0.8 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MVVATCTRSVDRRRDRGVSSSWFRLALGRRRLIGPGTAVLLAAAVVTGSAPAVSAATLTS
CEEEECHHHHHHHHHCCCCHHHHHHHHCCCEECCCCHHHHHHHHHHCCCCCCHHHHHHHH
IFATEANRTGENGATANSACDSELRFCSTAIGTGADASGVASTALASEAVASGTKAIAIG
HHHHCCCCCCCCCCCCCCCCHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHCCCEEEEEC
GRSSASGENSIALGTSAQAAGSQATAVGLQSNAGGGNSIALGFGAQTRAGDATDPDGATS
CCCCCCCCCCEEECCCCCCCCCCEEEEEEECCCCCCCEEEEECCCCCCCCCCCCCCCCCE
AVAIGSGAQANGEQSLSFGSLAEATGEGSVAIGPLSKVSAKNGVGIGNDNKVSGIDSVGI
EEEECCCCCCCCCCCCCCCCHHHHCCCCCEEECCCHHHHCCCCCCCCCCCCCCCCCCCCC
GTGNSVTGEKSVGIGYANTVSGDNSGAIGDPTTITGTGSYSLGNDNTIDADNAGTFGNDN
CCCCCCCCCCCCCCCEEEECCCCCCCCCCCCCEEECCCCEECCCCCEECCCCCCCCCCCC
KLANTADGSRIVGNGNDIDVGDAFVLGNTADVTVEGGVALGTSSVSDTGAVDGYVPFGAS
CCCCCCCCCEEECCCCCCCCCCEEEECCCCEEEEECCEEECCCCCCCCCCCCCCCCCCCC
EADRNAIAETKSTSGAVAVGNDAPGAEIYRQITGLAAGTADSDAVNVSQLKALEGGVKNA
CCCCHHHHHCCCCCCEEEECCCCCHHHHHHHHHHHHCCCCCCCCCCHHHHHHHHCCHHHC
VSYDTDAAGQKLNTITLKGGDPNQPVLVANVAKGVKDTDAANVGQVKEGIAETKHYTDEK
CCCCCCCCCCEEEEEEEECCCCCCCEEEEEHHCCCCCCCCCCHHHHHHHHHHHHHCCCCC
TNWAIDQSASYTDTVTDTKVRAANHYTDQKFSQLSGELGEVRGEARQAAAIGLAASSLRF
CCEEECCCCCCCCCCCCCEEECCCCCCHHHHHHHHHHHHHHHHHHHHHHHHEEEHHHCEE
DDRPGKLSVALGGGFWRSEAALAFGAGYTSENGRMRANLTGTAAGGHVGVGAGLSITLN
CCCCCEEEEEECCCEECCCCEEEEECCEECCCCEEEEEEEEECCCCCEEECCCEEEEEC
>Mature Secondary Structure
MVVATCTRSVDRRRDRGVSSSWFRLALGRRRLIGPGTAVLLAAAVVTGSAPAVSAATLTS
CEEEECHHHHHHHHHCCCCHHHHHHHHCCCEECCCCHHHHHHHHHHCCCCCCHHHHHHHH
IFATEANRTGENGATANSACDSELRFCSTAIGTGADASGVASTALASEAVASGTKAIAIG
HHHHCCCCCCCCCCCCCCCCHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHCCCEEEEEC
GRSSASGENSIALGTSAQAAGSQATAVGLQSNAGGGNSIALGFGAQTRAGDATDPDGATS
CCCCCCCCCCEEECCCCCCCCCCEEEEEEECCCCCCCEEEEECCCCCCCCCCCCCCCCCE
AVAIGSGAQANGEQSLSFGSLAEATGEGSVAIGPLSKVSAKNGVGIGNDNKVSGIDSVGI
EEEECCCCCCCCCCCCCCCCHHHHCCCCCEEECCCHHHHCCCCCCCCCCCCCCCCCCCCC
GTGNSVTGEKSVGIGYANTVSGDNSGAIGDPTTITGTGSYSLGNDNTIDADNAGTFGNDN
CCCCCCCCCCCCCCCEEEECCCCCCCCCCCCCEEECCCCEECCCCCEECCCCCCCCCCCC
KLANTADGSRIVGNGNDIDVGDAFVLGNTADVTVEGGVALGTSSVSDTGAVDGYVPFGAS
CCCCCCCCCEEECCCCCCCCCCEEEECCCCEEEEECCEEECCCCCCCCCCCCCCCCCCCC
EADRNAIAETKSTSGAVAVGNDAPGAEIYRQITGLAAGTADSDAVNVSQLKALEGGVKNA
CCCCHHHHHCCCCCCEEEECCCCCHHHHHHHHHHHHCCCCCCCCCCHHHHHHHHCCHHHC
VSYDTDAAGQKLNTITLKGGDPNQPVLVANVAKGVKDTDAANVGQVKEGIAETKHYTDEK
CCCCCCCCCCEEEEEEEECCCCCCCEEEEEHHCCCCCCCCCCHHHHHHHHHHHHHCCCCC
TNWAIDQSASYTDTVTDTKVRAANHYTDQKFSQLSGELGEVRGEARQAAAIGLAASSLRF
CCEEECCCCCCCCCCCCCEEECCCCCCHHHHHHHHHHHHHHHHHHHHHHHHEEEHHHCEE
DDRPGKLSVALGGGFWRSEAALAFGAGYTSENGRMRANLTGTAAGGHVGVGAGLSITLN
CCCCCEEEEEECCCEECCCCEEEEECCEECCCCEEEEEEEEECCCCCEEECCCEEEEEC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 3043229; 2761389; 2592347; 1548243; 12183532 [H]