Definition Escherichia coli ED1a chromosome, complete genome.
Accession NC_011745
Length 5,209,548

Click here to switch to the map view.

The map label for this gene is eibD [H]

Identifier: 218689809

GI number: 218689809

Start: 2026283

End: 2027836

Strand: Reverse

Name: eibD [H]

Synonym: ECED1_2077

Alternate gene names: 218689809

Gene position: 2027836-2026283 (Counterclockwise)

Preceding gene: 218689810

Following gene: 218689808

Centisome position: 38.93

GC content: 48.07

Gene sequence:

>1554_bases
ATGAACAAAAAATTCACTAAAACAATTCTTTCTGCCGCAGTGGCGGGATTGTTTCTGGCGGGTAATGCATCGGCGCAAGC
GAAAGCAGTATCAACGAAAGCAGAATCAACAGAAGAATATTATACATTTGGTAAGCAGTCGGATGGCACACAATATCGCT
TGTCCAGAAATGACGGTGGACATAGTGCGACATTTCGACTTGTGAAAATCGATAATAATAAAAAAGAAGTCGCCATCCCC
GGACTTACAGATATAGAAAAAGACGGCTCTGTTTACGTAACCGGATATAACGGGGAACGCACCAAAGTTAAAGCGGGCGA
TGTGTCAACGATGGTTAAGTACATTCTTGATGAGAAAAACATTCTTGCTAAGAAAAACACTGGCCCATATAACAAGGACG
TCAATAAGAACAGCAAGGCTAACGCCCCGGTGAAAGGATATATTGACGCAGCATCTGAAGCAGCCCGTACAGTTGCGCTT
AAACCTGCGCTGGGTAAAGGTGCTGTAGCCAGCGAACAATACACCGTTGCTGTTGGTAACGATGCTAGGGCTACAGAAAA
AGCGTCAACAGCAGTGGGCTCATGGGCTGCTGCGGACGGTAAACAAAGTACAGCTCTGGGAGTGGGAACATATGCTTATG
CAAATGCATCTACAGCCCTGGGAAGCGTTGCATTTGTTGATTACACGGCTACATATGGCACGGCAGCAGGTAACCGAGCC
AAAGTTGATAAAGATGCAACAGAAGGTACTGCGTTAGGGGCAAAGGCAACAGTAACAAATAAAAACAGTGTTGCATTAGG
TGCTAATTCTGTAACCACTCGTGATAACGAAGTTTATATTGGCTATAAAACCGGAACCGAAAGCGATAAAACATACGGCA
CCCGTGTTCTTGGTGGCTTAAGCGATGGTACGCGTAACAGTGATGCGGCAACTGTTGGGCAGTTAAACCGGAAAGTTGGT
GGAGTTTATGATGATGTTAAAGCCCGTATAACTGTTGAGTCAGAGAAGCAGAAAAAATACACAGACCAGAAGACCAGTGA
GGTTAACGAAAAAGTCGAATCCCGCACACTGGTTGGTGTGAGTTCTGATGGCACCCTGACCCGTGCAGAAGGTGCAAAGA
ACACCATTTCTGTTAACGATGGTCTGGTGGCCCTGTCTGGTCGTACTGACCGTATTGATGCAGCAGTTGGTGCCATTGAT
GGCCGTGTCACCCGTAACACGCAATCCATTGAGAAAAACAGCAAGGCGATTGCAGCCAATACCCGTACGCTGCAGCAACA
TTCAGCACGTCTGGACAGCCAGCAGCGCCAGATTAATGAAAACCATAAGGAAATGAAACGAGCAGCAGCACAGTCTGCGG
CCCTGACAGGTCTGTTCCAGCCGTACAGTGTGGGTAAATTCAACGCCACGGCAGCGGTTGGTGGTTACAGCGACCAGCAG
GCACTGGCGGTGGGTGTGGGTTACCGCTTCAACGAGCAGACCGCAGCGAAAGCAGGCGTGGCATTCAGTGATGGCGATGC
CTCCTGGAACGTTGGTGTGAACTTCGAGTTTTAA

Upstream 100 bases:

>100_bases
TGGCAGGAAGCAGCCAGTTATCAGATTTTCTTTAGTGTATCTGAAGTGCGTCTGAGAGGGTTGCTTTTTTTGTATACAAA
GAAATTACAGGATATATCAG

Downstream 100 bases:

>100_bases
TTGCTGAAGGTGACATGAAGTATGACGGCAGGCGCAGGACTCTGGTCTGCCGTTTTTCATGGGGCATAAAAACAGGAAGG
TGCTGCGATGAAGGTAATTC

Product: Immunoglobulin-binding protein from prophage P-EibD

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 517; Mature: 517

Protein sequence:

>517_residues
MNKKFTKTILSAAVAGLFLAGNASAQAKAVSTKAESTEEYYTFGKQSDGTQYRLSRNDGGHSATFRLVKIDNNKKEVAIP
GLTDIEKDGSVYVTGYNGERTKVKAGDVSTMVKYILDEKNILAKKNTGPYNKDVNKNSKANAPVKGYIDAASEAARTVAL
KPALGKGAVASEQYTVAVGNDARATEKASTAVGSWAAADGKQSTALGVGTYAYANASTALGSVAFVDYTATYGTAAGNRA
KVDKDATEGTALGAKATVTNKNSVALGANSVTTRDNEVYIGYKTGTESDKTYGTRVLGGLSDGTRNSDAATVGQLNRKVG
GVYDDVKARITVESEKQKKYTDQKTSEVNEKVESRTLVGVSSDGTLTRAEGAKNTISVNDGLVALSGRTDRIDAAVGAID
GRVTRNTQSIEKNSKAIAANTRTLQQHSARLDSQQRQINENHKEMKRAAAQSAALTGLFQPYSVGKFNATAAVGGYSDQQ
ALAVGVGYRFNEQTAAKAGVAFSDGDASWNVGVNFEF

Sequences:

>Translated_517_residues
MNKKFTKTILSAAVAGLFLAGNASAQAKAVSTKAESTEEYYTFGKQSDGTQYRLSRNDGGHSATFRLVKIDNNKKEVAIP
GLTDIEKDGSVYVTGYNGERTKVKAGDVSTMVKYILDEKNILAKKNTGPYNKDVNKNSKANAPVKGYIDAASEAARTVAL
KPALGKGAVASEQYTVAVGNDARATEKASTAVGSWAAADGKQSTALGVGTYAYANASTALGSVAFVDYTATYGTAAGNRA
KVDKDATEGTALGAKATVTNKNSVALGANSVTTRDNEVYIGYKTGTESDKTYGTRVLGGLSDGTRNSDAATVGQLNRKVG
GVYDDVKARITVESEKQKKYTDQKTSEVNEKVESRTLVGVSSDGTLTRAEGAKNTISVNDGLVALSGRTDRIDAAVGAID
GRVTRNTQSIEKNSKAIAANTRTLQQHSARLDSQQRQINENHKEMKRAAAQSAALTGLFQPYSVGKFNATAAVGGYSDQQ
ALAVGVGYRFNEQTAAKAGVAFSDGDASWNVGVNFEF
>Mature_517_residues
MNKKFTKTILSAAVAGLFLAGNASAQAKAVSTKAESTEEYYTFGKQSDGTQYRLSRNDGGHSATFRLVKIDNNKKEVAIP
GLTDIEKDGSVYVTGYNGERTKVKAGDVSTMVKYILDEKNILAKKNTGPYNKDVNKNSKANAPVKGYIDAASEAARTVAL
KPALGKGAVASEQYTVAVGNDARATEKASTAVGSWAAADGKQSTALGVGTYAYANASTALGSVAFVDYTATYGTAAGNRA
KVDKDATEGTALGAKATVTNKNSVALGANSVTTRDNEVYIGYKTGTESDKTYGTRVLGGLSDGTRNSDAATVGQLNRKVG
GVYDDVKARITVESEKQKKYTDQKTSEVNEKVESRTLVGVSSDGTLTRAEGAKNTISVNDGLVALSGRTDRIDAAVGAID
GRVTRNTQSIEKNSKAIAANTRTLQQHSARLDSQQRQINENHKEMKRAAAQSAALTGLFQPYSVGKFNATAAVGGYSDQQ
ALAVGVGYRFNEQTAAKAGVAFSDGDASWNVGVNFEF

Specific function: Collagen-binding outer membrane protein forming a fibrillar matrix on the bacterial cell surface. Promotes attachment to eukaryotic cells and after invasion, is the major adhesin in infected tissue. Constitutes an alternative uptake pathway under conditio

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cell outer membrane [H]

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Belongs to the autotransporter-2 (TC 1.B.40) / oligomeric coiled-coil adhesin (Oca) family [H]

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR008640
- InterPro:   IPR008635
- InterPro:   IPR008126
- InterPro:   IPR005594 [H]

Pfam domain/function: PF05658 Hep_Hag; PF05662 HIM; PF03895 YadA [H]

EC number: NA

Molecular weight: Translated: 54314; Mature: 54314

Theoretical pI: Translated: 9.85; Mature: 9.85

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.0 %Cys     (Translated Protein)
0.6 %Met     (Translated Protein)
0.6 %Cys+Met (Translated Protein)
0.0 %Cys     (Mature Protein)
0.6 %Met     (Mature Protein)
0.6 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MNKKFTKTILSAAVAGLFLAGNASAQAKAVSTKAESTEEYYTFGKQSDGTQYRLSRNDGG
CCCHHHHHHHHHHHHHEEEECCCCCCHHEECCCCCCCHHHHCCCCCCCCCEEEEECCCCC
HSATFRLVKIDNNKKEVAIPGLTDIEKDGSVYVTGYNGERTKVKAGDVSTMVKYILDEKN
CEEEEEEEEECCCCCEEECCCCCCCCCCCCEEEEEECCCEEEEECCCHHHHHHHHHCCCC
ILAKKNTGPYNKDVNKNSKANAPVKGYIDAASEAARTVALKPALGKGAVASEQYTVAVGN
EEEECCCCCCCCCCCCCCCCCCCEEEEHHHHHHHHEEEEECCCCCCCCCCCCCEEEEECC
DARATEKASTAVGSWAAADGKQSTALGVGTYAYANASTALGSVAFVDYTATYGTAAGNRA
CCCCHHHHHHHHCCCCCCCCCCCCEEEECEEEECCCHHHCCEEEEEEEEECCCCCCCCCC
KVDKDATEGTALGAKATVTNKNSVALGANSVTTRDNEVYIGYKTGTESDKTYGTRVLGGL
CCCCCCCCCCCCCCEEEEECCCCEEECCCCEECCCCEEEEEEECCCCCCCCCCHHEEECC
SDGTRNSDAATVGQLNRKVGGVYDDVKARITVESEKQKKYTDQKTSEVNEKVESRTLVGV
CCCCCCCCCHHHHHHHHHHCCEECCCEEEEEEECHHHHHHCCHHHHHHHHHHHHEEEEEE
SSDGTLTRAEGAKNTISVNDGLVALSGRTDRIDAAVGAIDGRVTRNTQSIEKNSKAIAAN
CCCCCEEECCCCCCEEEECCCEEEECCCCCHHHHHHHCCCCEEECCHHHHHCCCCEEEEC
TRTLQQHSARLDSQQRQINENHKEMKRAAAQSAALTGLFQPYSVGKFNATAAVGGYSDQQ
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCEEEECCCCCCC
ALAVGVGYRFNEQTAAKAGVAFSDGDASWNVGVNFEF
EEEEEECCEECCCHHHHCCCEEECCCCCEEEEEEECC
>Mature Secondary Structure
MNKKFTKTILSAAVAGLFLAGNASAQAKAVSTKAESTEEYYTFGKQSDGTQYRLSRNDGG
CCCHHHHHHHHHHHHHEEEECCCCCCHHEECCCCCCCHHHHCCCCCCCCCEEEEECCCCC
HSATFRLVKIDNNKKEVAIPGLTDIEKDGSVYVTGYNGERTKVKAGDVSTMVKYILDEKN
CEEEEEEEEECCCCCEEECCCCCCCCCCCCEEEEEECCCEEEEECCCHHHHHHHHHCCCC
ILAKKNTGPYNKDVNKNSKANAPVKGYIDAASEAARTVALKPALGKGAVASEQYTVAVGN
EEEECCCCCCCCCCCCCCCCCCCEEEEHHHHHHHHEEEEECCCCCCCCCCCCCEEEEECC
DARATEKASTAVGSWAAADGKQSTALGVGTYAYANASTALGSVAFVDYTATYGTAAGNRA
CCCCHHHHHHHHCCCCCCCCCCCCEEEECEEEECCCHHHCCEEEEEEEEECCCCCCCCCC
KVDKDATEGTALGAKATVTNKNSVALGANSVTTRDNEVYIGYKTGTESDKTYGTRVLGGL
CCCCCCCCCCCCCCEEEEECCCCEEECCCCEECCCCEEEEEEECCCCCCCCCCHHEEECC
SDGTRNSDAATVGQLNRKVGGVYDDVKARITVESEKQKKYTDQKTSEVNEKVESRTLVGV
CCCCCCCCCHHHHHHHHHHCCEECCCEEEEEEECHHHHHHCCHHHHHHHHHHHHEEEEEE
SSDGTLTRAEGAKNTISVNDGLVALSGRTDRIDAAVGAIDGRVTRNTQSIEKNSKAIAAN
CCCCCEEECCCCCCEEEECCCEEEECCCCCHHHHHHHCCCCEEECCHHHHHCCCCEEEEC
TRTLQQHSARLDSQQRQINENHKEMKRAAAQSAALTGLFQPYSVGKFNATAAVGGYSDQQ
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCEEEECCCCCCC
ALAVGVGYRFNEQTAAKAGVAFSDGDASWNVGVNFEF
EEEEEECCEECCCHHHHCCCEEECCCCCEEEEEEECC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 3043229; 2761389; 2592347; 1548243; 12183532 [H]