| Definition | Escherichia coli SMS-3-5 chromosome, complete genome. |
|---|---|
| Accession | NC_010498 |
| Length | 5,068,389 |
Click here to switch to the map view.
The map label for this gene is ycbS [H]
Identifier: 170682116
GI number: 170682116
Start: 2185632
End: 2188232
Strand: Reverse
Name: ycbS [H]
Synonym: EcSMS35_2179
Alternate gene names: 170682116
Gene position: 2188232-2185632 (Counterclockwise)
Preceding gene: 170682796
Following gene: 170683719
Centisome position: 43.17
GC content: 47.6
Gene sequence:
>2601_bases ATGTATAGAACTCAACGACAACACAGCCTGTTAAGCTCTGGTGGAGTGCCATCGTTTATTGGTGGGCTGGTGGTGTTTGT GTCGGCAGCGTTCAATGCACAAGCTGAAACCTGGTTCGATCCAGCCTTTTTCAAAGATGATCCCTCAATGGTGGCTGATT TGTCTCGTTTCGAAAAAGGGCAAAAAATAACGCCAGGGGTTTATCGAGTCGATATTGTTCTGAATCAGACAATTGTAGAT ACGCGCAACGTCAATTTTGTTGAGATAACGCCAGAGAAGGGGATTGCCGCCTGTTTGACGACTGAAAGCCTGGATGCAAT GGGCGTGAATACTGATGCGTTTCCGGCTTTTAAACAACTGGATAAACAAGCGTGTGCGCCATTGGCGGAAATTATTCCGG ATGCCAGCGTAACTTTTAATGTGAATAAACTCCGTCTGGAAATTTCAGTACCGCAAATCGCCATCAAAAGTAACGCTCGT GGTTATGTCCCCCCTGAACGTTGGGATGAAGGGATCAACGCGCTATTACTGGGATATTCATTTAGCGGGGCTAACAGTAT TCATAGCAGCGCAGGTAGTGATTCTGGCGACAGCTATTTTCTGAATTTAAACAGTGGCGTTAATTTAGGCCCATGGAGAT TGCGCAACAATTCAACATGGAGTCGCAGTAGTGGCCAAACCGCAGAATGGAAGAATCTCAGCAGCTATTTGCAGCGGGCG GTGATTCCATTAAAAGGCGAACTGACCGTCGGTGATGATTATACGGCAGGCGATTTTTTTGATAGCGTCAGCTTTCGTGG CGTGCAGCTGGCGTCAGATGACAACATGCTGCCAGACAGCTTGAAAGGGTTTGCGCCAGTGGTGCGTGGTATCGCCAAAA GCAATGCACAGGTAACGATTAAGCAAAATGGTTACACCATCTATCAAACTTATGTTTCGCCTGGCGCTTTTGAGATTAGT GATCTCTACTCTACGTCGTCGAGTGGTGATTTGTTGGTTGAAATCAAAGAAGCTGACGGTAGTGTCAATAGTTACAGTGT GCCCTTTTCCAGCGTGCCATTACTCCAGCGTCAGGGACGCATCAAATATGCGGTGACGCTGGCGAAATACAGAACCAATA GTAATGACCAGCAAGAAAGTAAATTTGCTCAGGCCACGCTGCAATGGGGTGGGCCGAGGGGAACGACCTGGTATGGCGGA GGGCAATATGCTGAATATTACCGTGCCGCTATGTTTGGTCTGGGTTTTAACCTCGGCGATTTCGGAGCAATTTCGTTCGA CGCGACCCAGGCTAAAAGTACGCTGGCAGACCAAAGTGAACATAAAGGGCAGTCATATCGTTTTCTGTATGCCAAAACGC TCAACCAATTGGGCACCAACTTTCAATTGATGGGCTACCGCTATTCGACGTCGGGTTTCTACACCCTTTCCGACACTATG TATAAACACATGGATGGCTACGAATTTAATGACGGTGATGATGAAGATACGCCAATGTGGTCGCGTTATTACAATTTGTT TTACACAAAACGTGGCAAACTGCAGGTCAACATCTCCCAGCAATTAGGCGAGTACGGTTCGTTTTATTTAAGCGGTAGCC AGCAAACTTACTGGCATACCGATCAACAGGATCGGCTATTACAGTTTGGCTACAACACGCAAATTAAAGATCTCTCGCTG GGGGTTTCCTGGAACTACAGTAAGTCCCGTGGTCAACCTGACGCTGACCAGGTGTTTGCACTTAATTTTTCCCTGCCGCT CAATCTGTTGCTCCCCAAAAGTAATGATAGCTATACCAGGAAAAAAAATTACGCCTGGATGACCTCTAATACCAGTATCG ATAACGAAGGGCACACTACACAAAACCTGGGTTTAACGGAGACACTACTCGATGACGGTAATCTGAGCTACAGCGTGCAA CAGGGATATAACAGCGAGGGGAAAACGGCTAATGGTAGCGCCAGCATGGACTACAAAGGGGCGTTTGCAGATGCTCGAGT GGGCTACAACTACAGCGATAACGGCAGTCAACAACAACTGAACTACGCTCTTTCAGGCAGTTTAGTTGCCCATTCGCAGG GTATTACGTTGGGTCAATCATTGGGTGAAACTAATGTCCTGATTGCCGCGCCAGGCGCCGAAAATACTCGTGTGGCGAAC AGCACCGGGCTGAAAACTGACTGGCGTGGATATACCGTTGTGCCTTATGCCACTTCTTATCGGGAAAATCGAATTGCACT TGATGCGGCGTCGTTAAAACGTAACGTGGATCTTGAAAATGCCGTAGTAAACGTGGTTCCCACCAAAGGGGCATTGGTTC TGGCGGAGTTCAATGCCCATGCGGGGGCTAGGGTATTAATGAAAACATCAAAGCAGGGTATGCCGCTGAGATTTGGTGCA ATGGCAACACTGGATGGCGCACAAACAATTAGCGGTATCATTGATGATGATGGTTCGCTCTATATGTCTGGTTTGCCGGC GAAGGGAACGATAACTGTACGCTGGGGCGACGCTCCCGATCAAATTTGTCATATCAGTTACGAGCTTACCGAACAACAAA TTAACGCTGCGATTACGCGGATGGATTCAGTATGCGAATAA
Upstream 100 bases:
>100_bases CAAAAACAGCAGCGTAACGTACCGAACTATCAATGACTACGGGGCGGAAACGCCGCAACTCAACTGTAAATCGTAATTCG TCTTCATTTAAGAGAGCGAG
Downstream 100 bases:
>100_bases TTTCAGGGGATAGTAGTGTGTTAAGACTCCGGCTTCTTTTGACTGCTGTTTTAATGCTGTGGGGATTTCATGCCGCCGCT TATACCGGGCAGTGTCATAC
Product: outer membrane usher protein fimD-like protein
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 866; Mature: 866
Protein sequence:
>866_residues MYRTQRQHSLLSSGGVPSFIGGLVVFVSAAFNAQAETWFDPAFFKDDPSMVADLSRFEKGQKITPGVYRVDIVLNQTIVD TRNVNFVEITPEKGIAACLTTESLDAMGVNTDAFPAFKQLDKQACAPLAEIIPDASVTFNVNKLRLEISVPQIAIKSNAR GYVPPERWDEGINALLLGYSFSGANSIHSSAGSDSGDSYFLNLNSGVNLGPWRLRNNSTWSRSSGQTAEWKNLSSYLQRA VIPLKGELTVGDDYTAGDFFDSVSFRGVQLASDDNMLPDSLKGFAPVVRGIAKSNAQVTIKQNGYTIYQTYVSPGAFEIS DLYSTSSSGDLLVEIKEADGSVNSYSVPFSSVPLLQRQGRIKYAVTLAKYRTNSNDQQESKFAQATLQWGGPRGTTWYGG GQYAEYYRAAMFGLGFNLGDFGAISFDATQAKSTLADQSEHKGQSYRFLYAKTLNQLGTNFQLMGYRYSTSGFYTLSDTM YKHMDGYEFNDGDDEDTPMWSRYYNLFYTKRGKLQVNISQQLGEYGSFYLSGSQQTYWHTDQQDRLLQFGYNTQIKDLSL GVSWNYSKSRGQPDADQVFALNFSLPLNLLLPKSNDSYTRKKNYAWMTSNTSIDNEGHTTQNLGLTETLLDDGNLSYSVQ QGYNSEGKTANGSASMDYKGAFADARVGYNYSDNGSQQQLNYALSGSLVAHSQGITLGQSLGETNVLIAAPGAENTRVAN STGLKTDWRGYTVVPYATSYRENRIALDAASLKRNVDLENAVVNVVPTKGALVLAEFNAHAGARVLMKTSKQGMPLRFGA MATLDGAQTISGIIDDDGSLYMSGLPAKGTITVRWGDAPDQICHISYELTEQQINAAITRMDSVCE
Sequences:
>Translated_866_residues MYRTQRQHSLLSSGGVPSFIGGLVVFVSAAFNAQAETWFDPAFFKDDPSMVADLSRFEKGQKITPGVYRVDIVLNQTIVD TRNVNFVEITPEKGIAACLTTESLDAMGVNTDAFPAFKQLDKQACAPLAEIIPDASVTFNVNKLRLEISVPQIAIKSNAR GYVPPERWDEGINALLLGYSFSGANSIHSSAGSDSGDSYFLNLNSGVNLGPWRLRNNSTWSRSSGQTAEWKNLSSYLQRA VIPLKGELTVGDDYTAGDFFDSVSFRGVQLASDDNMLPDSLKGFAPVVRGIAKSNAQVTIKQNGYTIYQTYVSPGAFEIS DLYSTSSSGDLLVEIKEADGSVNSYSVPFSSVPLLQRQGRIKYAVTLAKYRTNSNDQQESKFAQATLQWGGPRGTTWYGG GQYAEYYRAAMFGLGFNLGDFGAISFDATQAKSTLADQSEHKGQSYRFLYAKTLNQLGTNFQLMGYRYSTSGFYTLSDTM YKHMDGYEFNDGDDEDTPMWSRYYNLFYTKRGKLQVNISQQLGEYGSFYLSGSQQTYWHTDQQDRLLQFGYNTQIKDLSL GVSWNYSKSRGQPDADQVFALNFSLPLNLLLPKSNDSYTRKKNYAWMTSNTSIDNEGHTTQNLGLTETLLDDGNLSYSVQ QGYNSEGKTANGSASMDYKGAFADARVGYNYSDNGSQQQLNYALSGSLVAHSQGITLGQSLGETNVLIAAPGAENTRVAN STGLKTDWRGYTVVPYATSYRENRIALDAASLKRNVDLENAVVNVVPTKGALVLAEFNAHAGARVLMKTSKQGMPLRFGA MATLDGAQTISGIIDDDGSLYMSGLPAKGTITVRWGDAPDQICHISYELTEQQINAAITRMDSVCE >Mature_866_residues MYRTQRQHSLLSSGGVPSFIGGLVVFVSAAFNAQAETWFDPAFFKDDPSMVADLSRFEKGQKITPGVYRVDIVLNQTIVD TRNVNFVEITPEKGIAACLTTESLDAMGVNTDAFPAFKQLDKQACAPLAEIIPDASVTFNVNKLRLEISVPQIAIKSNAR GYVPPERWDEGINALLLGYSFSGANSIHSSAGSDSGDSYFLNLNSGVNLGPWRLRNNSTWSRSSGQTAEWKNLSSYLQRA VIPLKGELTVGDDYTAGDFFDSVSFRGVQLASDDNMLPDSLKGFAPVVRGIAKSNAQVTIKQNGYTIYQTYVSPGAFEIS DLYSTSSSGDLLVEIKEADGSVNSYSVPFSSVPLLQRQGRIKYAVTLAKYRTNSNDQQESKFAQATLQWGGPRGTTWYGG GQYAEYYRAAMFGLGFNLGDFGAISFDATQAKSTLADQSEHKGQSYRFLYAKTLNQLGTNFQLMGYRYSTSGFYTLSDTM YKHMDGYEFNDGDDEDTPMWSRYYNLFYTKRGKLQVNISQQLGEYGSFYLSGSQQTYWHTDQQDRLLQFGYNTQIKDLSL GVSWNYSKSRGQPDADQVFALNFSLPLNLLLPKSNDSYTRKKNYAWMTSNTSIDNEGHTTQNLGLTETLLDDGNLSYSVQ QGYNSEGKTANGSASMDYKGAFADARVGYNYSDNGSQQQLNYALSGSLVAHSQGITLGQSLGETNVLIAAPGAENTRVAN STGLKTDWRGYTVVPYATSYRENRIALDAASLKRNVDLENAVVNVVPTKGALVLAEFNAHAGARVLMKTSKQGMPLRFGA MATLDGAQTISGIIDDDGSLYMSGLPAKGTITVRWGDAPDQICHISYELTEQQINAAITRMDSVCE
Specific function: Could be involved in the export and assembly of the putative ycbQ fimbrial subunit across the outer membrane [H]
COG id: COG3188
COG function: function code NU; P pilus assembly protein, porin PapC
Gene ontology:
Cell location: Cell outer membrane; Multi-pass membrane protein [H]
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the fimbrial export usher family [H]
Homologues:
Organism=Escherichia coli, GI1787172, Length=866, Percent_Identity=97.459584295612, Blast_Score=1729, Evalue=0.0, Organism=Escherichia coli, GI1790772, Length=857, Percent_Identity=48.7747957992999, Blast_Score=823, Evalue=0.0, Organism=Escherichia coli, GI1786744, Length=850, Percent_Identity=45.0588235294118, Blast_Score=753, Evalue=0.0, Organism=Escherichia coli, GI1789533, Length=872, Percent_Identity=38.9908256880734, Blast_Score=560, Evalue=1e-160, Organism=Escherichia coli, GI1786332, Length=842, Percent_Identity=32.6603325415677, Blast_Score=387, Evalue=1e-108, Organism=Escherichia coli, GI1788427, Length=774, Percent_Identity=32.2997416020672, Blast_Score=359, Evalue=1e-100, Organism=Escherichia coli, GI87081778, Length=857, Percent_Identity=26.7211201866978, Blast_Score=248, Evalue=1e-66, Organism=Escherichia coli, GI1789610, Length=814, Percent_Identity=24.8157248157248, Blast_Score=130, Evalue=5e-31,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR000015 - InterPro: IPR018030 [H]
Pfam domain/function: PF00577 Usher [H]
EC number: NA
Molecular weight: Translated: 95023; Mature: 95023
Theoretical pI: Translated: 5.16; Mature: 5.16
Prosite motif: PS01151 FIMBRIAL_USHER
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.5 %Cys (Translated Protein) 1.8 %Met (Translated Protein) 2.3 %Cys+Met (Translated Protein) 0.5 %Cys (Mature Protein) 1.8 %Met (Mature Protein) 2.3 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MYRTQRQHSLLSSGGVPSFIGGLVVFVSAAFNAQAETWFDPAFFKDDPSMVADLSRFEKG CCCCCHHHHHHHCCCCHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCHHHHHHHHHHHCC QKITPGVYRVDIVLNQTIVDTRNVNFVEITPEKGIAACLTTESLDAMGVNTDAFPAFKQL CCCCCCEEEEEEEEECEEEECCCCEEEEECCCCCEEEEEEECCCCCCCCCCCCCHHHHHH DKQACAPLAEIIPDASVTFNVNKLRLEISVPQIAIKSNARGYVPPERWDEGINALLLGYS HHHHCCCHHHHCCCCEEEEEEEEEEEEEECCEEEEECCCCCCCCHHHHHCCCEEEEEEEE FSGANSIHSSAGSDSGDSYFLNLNSGVNLGPWRLRNNSTWSRSSGQTAEWKNLSSYLQRA CCCCCCHHHCCCCCCCCEEEEECCCCCCCCCEEECCCCCCCCCCCCCCHHHHHHHHHHHC VIPLKGELTVGDDYTAGDFFDSVSFRGVQLASDDNMLPDSLKGFAPVVRGIAKSNAQVTI CCCCCCEEEECCCCCCCHHHCCCCCCEEEEECCCCCCCHHHHHHHHHHHHHHCCCCEEEE KQNGYTIYQTYVSPGAFEISDLYSTSSSGDLLVEIKEADGSVNSYSVPFSSVPLLQRQGR EECCEEEEEEECCCCCEEEHHHHCCCCCCCEEEEEECCCCCCCEEECCCCCCCHHHHCCC IKYAVTLAKYRTNSNDQQESKFAQATLQWGGPRGTTWYGGGQYAEYYRAAMFGLGFNLGD EEEEEEEEEECCCCCCHHHHHHHHHHEECCCCCCCCCCCCCHHHHHHHHHHHHCCCCCCC FGAISFDATQAKSTLADQSEHKGQSYRFLYAKTLNQLGTNFQLMGYRYSTSGFYTLSDTM CCEEEECCHHHHHHHHCCHHCCCCCEEEEHHHHHHHHCCCEEEEEEEECCCCEEEEHHHH YKHMDGYEFNDGDDEDTPMWSRYYNLFYTKRGKLQVNISQQLGEYGSFYLSGSQQTYWHT HHHCCCCCCCCCCCCCCCHHHHHEEEEEEECCCEEEEHHHHCCCCCCEEEECCCCEEEEC DQQDRLLQFGYNTQIKDLSLGVSWNYSKSRGQPDADQVFALNFSLPLNLLLPKSNDSYTR CCHHHHEECCCCCCEEEEEEEEEECCHHCCCCCCCCCEEEEEECCCEEEEEECCCCCCCC KKNYAWMTSNTSIDNEGHTTQNLGLTETLLDDGNLSYSVQQGYNSEGKTANGSASMDYKG CCCEEEEECCCCCCCCCCCCCCCCCHHHHCCCCCEEEEEECCCCCCCCCCCCCCCCCCCC AFADARVGYNYSDNGSQQQLNYALSGSLVAHSQGITLGQSLGETNVLIAAPGAENTRVAN CCCCCEECCCCCCCCCHHHEEEEECCCEEEECCCCEECCCCCCCEEEEECCCCCCCEEEC STGLKTDWRGYTVVPYATSYRENRIALDAASLKRNVDLENAVVNVVPTKGALVLAEFNAH CCCCCCCCCCEEEEEEECCCCCCEEEEEHHHHHCCCCCCCEEEEEEECCCEEEEEECCCC AGARVLMKTSKQGMPLRFGAMATLDGAQTISGIIDDDGSLYMSGLPAKGTITVRWGDAPD CCEEEEEECCCCCCCEEECCEEECCCHHHHHHEECCCCCEEEECCCCCCEEEEEECCCCC QICHISYELTEQQINAAITRMDSVCE CEEEEEHHHHHHHHHHHHHHHHHHCC >Mature Secondary Structure MYRTQRQHSLLSSGGVPSFIGGLVVFVSAAFNAQAETWFDPAFFKDDPSMVADLSRFEKG CCCCCHHHHHHHCCCCHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCHHHHHHHHHHHCC QKITPGVYRVDIVLNQTIVDTRNVNFVEITPEKGIAACLTTESLDAMGVNTDAFPAFKQL CCCCCCEEEEEEEEECEEEECCCCEEEEECCCCCEEEEEEECCCCCCCCCCCCCHHHHHH DKQACAPLAEIIPDASVTFNVNKLRLEISVPQIAIKSNARGYVPPERWDEGINALLLGYS HHHHCCCHHHHCCCCEEEEEEEEEEEEEECCEEEEECCCCCCCCHHHHHCCCEEEEEEEE FSGANSIHSSAGSDSGDSYFLNLNSGVNLGPWRLRNNSTWSRSSGQTAEWKNLSSYLQRA CCCCCCHHHCCCCCCCCEEEEECCCCCCCCCEEECCCCCCCCCCCCCCHHHHHHHHHHHC VIPLKGELTVGDDYTAGDFFDSVSFRGVQLASDDNMLPDSLKGFAPVVRGIAKSNAQVTI CCCCCCEEEECCCCCCCHHHCCCCCCEEEEECCCCCCCHHHHHHHHHHHHHHCCCCEEEE KQNGYTIYQTYVSPGAFEISDLYSTSSSGDLLVEIKEADGSVNSYSVPFSSVPLLQRQGR EECCEEEEEEECCCCCEEEHHHHCCCCCCCEEEEEECCCCCCCEEECCCCCCCHHHHCCC IKYAVTLAKYRTNSNDQQESKFAQATLQWGGPRGTTWYGGGQYAEYYRAAMFGLGFNLGD EEEEEEEEEECCCCCCHHHHHHHHHHEECCCCCCCCCCCCCHHHHHHHHHHHHCCCCCCC FGAISFDATQAKSTLADQSEHKGQSYRFLYAKTLNQLGTNFQLMGYRYSTSGFYTLSDTM CCEEEECCHHHHHHHHCCHHCCCCCEEEEHHHHHHHHCCCEEEEEEEECCCCEEEEHHHH YKHMDGYEFNDGDDEDTPMWSRYYNLFYTKRGKLQVNISQQLGEYGSFYLSGSQQTYWHT HHHCCCCCCCCCCCCCCCHHHHHEEEEEEECCCEEEEHHHHCCCCCCEEEECCCCEEEEC DQQDRLLQFGYNTQIKDLSLGVSWNYSKSRGQPDADQVFALNFSLPLNLLLPKSNDSYTR CCHHHHEECCCCCCEEEEEEEEEECCHHCCCCCCCCCEEEEEECCCEEEEEECCCCCCCC KKNYAWMTSNTSIDNEGHTTQNLGLTETLLDDGNLSYSVQQGYNSEGKTANGSASMDYKG CCCEEEEECCCCCCCCCCCCCCCCCHHHHCCCCCEEEEEECCCCCCCCCCCCCCCCCCCC AFADARVGYNYSDNGSQQQLNYALSGSLVAHSQGITLGQSLGETNVLIAAPGAENTRVAN CCCCCEECCCCCCCCCHHHEEEEECCCEEEECCCCEECCCCCCCEEEEECCCCCCCEEEC STGLKTDWRGYTVVPYATSYRENRIALDAASLKRNVDLENAVVNVVPTKGALVLAEFNAH CCCCCCCCCCEEEEEEECCCCCCEEEEEHHHHHCCCCCCCEEEEEEECCCEEEEEECCCC AGARVLMKTSKQGMPLRFGAMATLDGAQTISGIIDDDGSLYMSGLPAKGTITVRWGDAPD CCEEEEEECCCCCCCEEECCEEECCCHHHHHHEECCCCCEEEECCCCCCEEEEEECCCCC QICHISYELTEQQINAAITRMDSVCE CEEEEEHHHHHHHHHHHHHHHHHHCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 6.0
TargetDB status: NA
Availability: NA
References: 8905232; 9278503 [H]