| Definition | Sinorhizobium medicae WSM419 chromosome, complete genome. |
|---|---|
| Accession | NC_009636 |
| Length | 3,781,904 |
Click here to switch to the map view.
The map label for this gene is yadA [H]
Identifier: 150395314
GI number: 150395314
Start: 95969
End: 97768
Strand: Direct
Name: yadA [H]
Synonym: Smed_0086
Alternate gene names: 150395314
Gene position: 95969-97768 (Clockwise)
Preceding gene: 150395313
Following gene: 150395315
Centisome position: 2.54
GC content: 62.56
Gene sequence:
>1800_bases TTGGTAGTAGCGACTTGCACACGTTCTGTTGATCGCAGGCGAGATCGAGGTGTCTCTTCAAGCTGGTTTCGGCTTGCGCT GGGGAGACGACGGCTGATTGGGCCGGGTACGGCCGTCTTGCTGGCAGCTGCCGTGGTGACAGGTTCCGCGCCGGCAGTCT CGGCCGCCACGCTGACCTCGATCTTCGCGACCGAGGCCAACAGAACCGGCGAAAACGGCGCGACCGCCAACTCTGCATGT GATTCGGAGCTGAGATTTTGCTCCACTGCGATCGGCACTGGTGCCGACGCAAGCGGTGTCGCTTCAACCGCGCTTGCTTC CGAGGCCGTGGCATCCGGAACGAAAGCAATTGCGATCGGCGGACGCTCGTCAGCGTCCGGGGAGAACAGCATTGCTCTAG GCACGTCTGCGCAAGCCGCGGGAAGTCAGGCCACCGCCGTCGGTCTGCAATCGAATGCCGGTGGCGGCAATTCGATCGCC TTGGGCTTTGGGGCGCAGACGAGGGCCGGGGATGCAACGGATCCGGACGGCGCGACCTCAGCCGTAGCGATCGGATCCGG CGCGCAGGCCAATGGCGAACAATCCCTGAGCTTCGGCTCATTAGCCGAGGCGACCGGTGAAGGAAGCGTCGCCATCGGTC CGCTCAGCAAAGTGTCGGCCAAAAATGGCGTCGGCATCGGTAACGATAACAAGGTTTCAGGCATCGACAGTGTCGGTATC GGTACCGGCAATTCGGTGACAGGTGAAAAAAGCGTCGGCATCGGATACGCCAATACCGTCTCGGGCGATAACAGTGGTGC AATAGGCGACCCGACCACCATTACGGGCACCGGTTCCTATTCTCTCGGCAACGACAACACCATCGACGCCGACAACGCCG GCACGTTCGGCAACGACAACAAACTGGCGAATACGGCCGATGGCAGCCGCATCGTAGGCAACGGCAACGACATAGATGTC GGGGACGCTTTCGTGCTCGGCAATACGGCCGACGTCACGGTCGAGGGCGGCGTCGCGCTCGGTACCAGCTCTGTTTCCGA CACCGGCGCGGTGGACGGCTACGTGCCGTTTGGTGCATCGGAAGCGGACAGAAACGCAATCGCCGAAACGAAAAGCACGA GCGGCGCCGTGGCAGTGGGCAATGATGCCCCCGGTGCCGAAATCTATCGCCAGATCACGGGGCTTGCCGCCGGTACGGCG GATTCCGATGCCGTCAATGTCTCACAGCTCAAGGCCCTCGAAGGCGGCGTGAAAAATGCCGTATCCTATGACACCGACGC CGCCGGCCAGAAGCTCAACACGATCACCTTGAAGGGTGGCGACCCCAACCAGCCGGTTCTCGTGGCCAATGTCGCCAAAG GCGTAAAGGACACCGATGCCGCCAATGTCGGTCAGGTCAAGGAAGGGATCGCCGAAACCAAGCACTACACGGACGAAAAG ACCAATTGGGCGATAGATCAGTCGGCCAGCTATACGGATACCGTCACGGACACCAAGGTCCGCGCGGCGAACCACTACAC GGATCAGAAATTCTCGCAGCTGTCGGGCGAGCTCGGGGAAGTTCGCGGGGAAGCCCGCCAGGCCGCCGCAATCGGCCTCG CGGCATCCTCCCTGCGTTTCGACGACCGGCCTGGCAAGCTAAGCGTAGCGCTTGGAGGCGGGTTCTGGAGGAGCGAAGCA GCACTCGCATTCGGCGCCGGCTACACGAGTGAGAACGGCCGCATGCGGGCAAATCTCACCGGAACGGCGGCCGGGGGGCA CGTCGGCGTTGGCGCGGGGCTCAGCATCACTTTGAACTGA
Upstream 100 bases:
>100_bases CAGAACGGCTGCTCTTCTCGGGCTTGGGTACCGAACAGGACTTATTCCCGAGCGACGGTGAGCGCTGGAGAGAGCAGGAT CATTCTTGAAGGAGGTTATC
Downstream 100 bases:
>100_bases GATGTCCAGGCAACTCGCCACCGTGCTTCCCGTCGCGGCTTGCATGGTCCTGTCCGGCGGCGCTCCCGCCGTCGGGCAGG GTGCGACGCCGGAACCCCGC
Product: YadA domain-containing protein
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 599; Mature: 599
Protein sequence:
>599_residues MVVATCTRSVDRRRDRGVSSSWFRLALGRRRLIGPGTAVLLAAAVVTGSAPAVSAATLTSIFATEANRTGENGATANSAC DSELRFCSTAIGTGADASGVASTALASEAVASGTKAIAIGGRSSASGENSIALGTSAQAAGSQATAVGLQSNAGGGNSIA LGFGAQTRAGDATDPDGATSAVAIGSGAQANGEQSLSFGSLAEATGEGSVAIGPLSKVSAKNGVGIGNDNKVSGIDSVGI GTGNSVTGEKSVGIGYANTVSGDNSGAIGDPTTITGTGSYSLGNDNTIDADNAGTFGNDNKLANTADGSRIVGNGNDIDV GDAFVLGNTADVTVEGGVALGTSSVSDTGAVDGYVPFGASEADRNAIAETKSTSGAVAVGNDAPGAEIYRQITGLAAGTA DSDAVNVSQLKALEGGVKNAVSYDTDAAGQKLNTITLKGGDPNQPVLVANVAKGVKDTDAANVGQVKEGIAETKHYTDEK TNWAIDQSASYTDTVTDTKVRAANHYTDQKFSQLSGELGEVRGEARQAAAIGLAASSLRFDDRPGKLSVALGGGFWRSEA ALAFGAGYTSENGRMRANLTGTAAGGHVGVGAGLSITLN
Sequences:
>Translated_599_residues MVVATCTRSVDRRRDRGVSSSWFRLALGRRRLIGPGTAVLLAAAVVTGSAPAVSAATLTSIFATEANRTGENGATANSAC DSELRFCSTAIGTGADASGVASTALASEAVASGTKAIAIGGRSSASGENSIALGTSAQAAGSQATAVGLQSNAGGGNSIA LGFGAQTRAGDATDPDGATSAVAIGSGAQANGEQSLSFGSLAEATGEGSVAIGPLSKVSAKNGVGIGNDNKVSGIDSVGI GTGNSVTGEKSVGIGYANTVSGDNSGAIGDPTTITGTGSYSLGNDNTIDADNAGTFGNDNKLANTADGSRIVGNGNDIDV GDAFVLGNTADVTVEGGVALGTSSVSDTGAVDGYVPFGASEADRNAIAETKSTSGAVAVGNDAPGAEIYRQITGLAAGTA DSDAVNVSQLKALEGGVKNAVSYDTDAAGQKLNTITLKGGDPNQPVLVANVAKGVKDTDAANVGQVKEGIAETKHYTDEK TNWAIDQSASYTDTVTDTKVRAANHYTDQKFSQLSGELGEVRGEARQAAAIGLAASSLRFDDRPGKLSVALGGGFWRSEA ALAFGAGYTSENGRMRANLTGTAAGGHVGVGAGLSITLN >Mature_599_residues MVVATCTRSVDRRRDRGVSSSWFRLALGRRRLIGPGTAVLLAAAVVTGSAPAVSAATLTSIFATEANRTGENGATANSAC DSELRFCSTAIGTGADASGVASTALASEAVASGTKAIAIGGRSSASGENSIALGTSAQAAGSQATAVGLQSNAGGGNSIA LGFGAQTRAGDATDPDGATSAVAIGSGAQANGEQSLSFGSLAEATGEGSVAIGPLSKVSAKNGVGIGNDNKVSGIDSVGI GTGNSVTGEKSVGIGYANTVSGDNSGAIGDPTTITGTGSYSLGNDNTIDADNAGTFGNDNKLANTADGSRIVGNGNDIDV GDAFVLGNTADVTVEGGVALGTSSVSDTGAVDGYVPFGASEADRNAIAETKSTSGAVAVGNDAPGAEIYRQITGLAAGTA DSDAVNVSQLKALEGGVKNAVSYDTDAAGQKLNTITLKGGDPNQPVLVANVAKGVKDTDAANVGQVKEGIAETKHYTDEK TNWAIDQSASYTDTVTDTKVRAANHYTDQKFSQLSGELGEVRGEARQAAAIGLAASSLRFDDRPGKLSVALGGGFWRSEA ALAFGAGYTSENGRMRANLTGTAAGGHVGVGAGLSITLN
Specific function: Collagen-binding outer membrane protein forming a fibrillar matrix on the bacterial cell surface. Promotes attachment to eukaryotic cells and after invasion, is the major adhesin in infected tissue. Constitutes an alternative uptake pathway under conditio
COG id: COG5295
COG function: function code UW; Autotransporter adhesin
Gene ontology:
Cell location: Cell outer membrane [H]
Metaboloic importance: NA
Operon status: Not Known
Operon components: None
Similarity: Belongs to the autotransporter-2 (TC 1.B.40) / oligomeric coiled-coil adhesin (Oca) family [H]
Homologues:
None
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR008640 - InterPro: IPR008635 - InterPro: IPR008126 - InterPro: IPR005594 [H]
Pfam domain/function: PF05658 Hep_Hag; PF05662 HIM; PF03895 YadA [H]
EC number: NA
Molecular weight: Translated: 58895; Mature: 58895
Theoretical pI: Translated: 4.50; Mature: 4.50
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.5 %Cys (Translated Protein) 0.3 %Met (Translated Protein) 0.8 %Cys+Met (Translated Protein) 0.5 %Cys (Mature Protein) 0.3 %Met (Mature Protein) 0.8 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MVVATCTRSVDRRRDRGVSSSWFRLALGRRRLIGPGTAVLLAAAVVTGSAPAVSAATLTS CEEEECHHHHHHHHHCCCCHHHHHHHHCCCEECCCCHHHHHHHHHHCCCCCCHHHHHHHH IFATEANRTGENGATANSACDSELRFCSTAIGTGADASGVASTALASEAVASGTKAIAIG HHHHCCCCCCCCCCCCCCCCHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHCCCEEEEEC GRSSASGENSIALGTSAQAAGSQATAVGLQSNAGGGNSIALGFGAQTRAGDATDPDGATS CCCCCCCCCCEEECCCCCCCCCCEEEEEEECCCCCCCEEEEECCCCCCCCCCCCCCCCCE AVAIGSGAQANGEQSLSFGSLAEATGEGSVAIGPLSKVSAKNGVGIGNDNKVSGIDSVGI EEEECCCCCCCCCCCCCCCCHHHHCCCCCEEECCCHHHHCCCCCCCCCCCCCCCCCCCCC GTGNSVTGEKSVGIGYANTVSGDNSGAIGDPTTITGTGSYSLGNDNTIDADNAGTFGNDN CCCCCCCCCCCCCCCEEEECCCCCCCCCCCCCEEECCCCEECCCCCEECCCCCCCCCCCC KLANTADGSRIVGNGNDIDVGDAFVLGNTADVTVEGGVALGTSSVSDTGAVDGYVPFGAS CCCCCCCCCEEECCCCCCCCCCEEEECCCCEEEEECCEEECCCCCCCCCCCCCCCCCCCC EADRNAIAETKSTSGAVAVGNDAPGAEIYRQITGLAAGTADSDAVNVSQLKALEGGVKNA CCCCHHHHHCCCCCCEEEECCCCCHHHHHHHHHHHHCCCCCCCCCCHHHHHHHHCCHHHC VSYDTDAAGQKLNTITLKGGDPNQPVLVANVAKGVKDTDAANVGQVKEGIAETKHYTDEK CCCCCCCCCCEEEEEEEECCCCCCCEEEEEHHCCCCCCCCCCHHHHHHHHHHHHHCCCCC TNWAIDQSASYTDTVTDTKVRAANHYTDQKFSQLSGELGEVRGEARQAAAIGLAASSLRF CCEEECCCCCCCCCCCCCEEECCCCCCHHHHHHHHHHHHHHHHHHHHHHHHEEEHHHCEE DDRPGKLSVALGGGFWRSEAALAFGAGYTSENGRMRANLTGTAAGGHVGVGAGLSITLN CCCCCEEEEEECCCEECCCCEEEEECCEECCCCEEEEEEEEECCCCCEEECCCEEEEEC >Mature Secondary Structure MVVATCTRSVDRRRDRGVSSSWFRLALGRRRLIGPGTAVLLAAAVVTGSAPAVSAATLTS CEEEECHHHHHHHHHCCCCHHHHHHHHCCCEECCCCHHHHHHHHHHCCCCCCHHHHHHHH IFATEANRTGENGATANSACDSELRFCSTAIGTGADASGVASTALASEAVASGTKAIAIG HHHHCCCCCCCCCCCCCCCCHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHCCCEEEEEC GRSSASGENSIALGTSAQAAGSQATAVGLQSNAGGGNSIALGFGAQTRAGDATDPDGATS CCCCCCCCCCEEECCCCCCCCCCEEEEEEECCCCCCCEEEEECCCCCCCCCCCCCCCCCE AVAIGSGAQANGEQSLSFGSLAEATGEGSVAIGPLSKVSAKNGVGIGNDNKVSGIDSVGI EEEECCCCCCCCCCCCCCCCHHHHCCCCCEEECCCHHHHCCCCCCCCCCCCCCCCCCCCC GTGNSVTGEKSVGIGYANTVSGDNSGAIGDPTTITGTGSYSLGNDNTIDADNAGTFGNDN CCCCCCCCCCCCCCCEEEECCCCCCCCCCCCCEEECCCCEECCCCCEECCCCCCCCCCCC KLANTADGSRIVGNGNDIDVGDAFVLGNTADVTVEGGVALGTSSVSDTGAVDGYVPFGAS CCCCCCCCCEEECCCCCCCCCCEEEECCCCEEEEECCEEECCCCCCCCCCCCCCCCCCCC EADRNAIAETKSTSGAVAVGNDAPGAEIYRQITGLAAGTADSDAVNVSQLKALEGGVKNA CCCCHHHHHCCCCCCEEEECCCCCHHHHHHHHHHHHCCCCCCCCCCHHHHHHHHCCHHHC VSYDTDAAGQKLNTITLKGGDPNQPVLVANVAKGVKDTDAANVGQVKEGIAETKHYTDEK CCCCCCCCCCEEEEEEEECCCCCCCEEEEEHHCCCCCCCCCCHHHHHHHHHHHHHCCCCC TNWAIDQSASYTDTVTDTKVRAANHYTDQKFSQLSGELGEVRGEARQAAAIGLAASSLRF CCEEECCCCCCCCCCCCCEEECCCCCCHHHHHHHHHHHHHHHHHHHHHHHHEEEHHHCEE DDRPGKLSVALGGGFWRSEAALAFGAGYTSENGRMRANLTGTAAGGHVGVGAGLSITLN CCCCCEEEEEECCCEECCCCEEEEECCEECCCCEEEEEEEEECCCCCEEECCCEEEEEC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 6.0
TargetDB status: NA
Availability: NA
References: 3043229; 2761389; 2592347; 1548243; 12183532 [H]