Definition Escherichia coli SMS-3-5 chromosome, complete genome.
Accession NC_010498
Length 5,068,389

Click here to switch to the map view.

The map label for this gene is lpfC [H]

Identifier: 170684256

GI number: 170684256

Start: 4187436

End: 4189958

Strand: Reverse

Name: lpfC [H]

Synonym: EcSMS35_4094

Alternate gene names: 170684256

Gene position: 4189958-4187436 (Counterclockwise)

Preceding gene: 170681205

Following gene: 170683702

Centisome position: 82.67

GC content: 47.52

Gene sequence:

>2523_bases
ATGATGACGACCAGAATAAAGGTTGGCCTCACGGCAGGGACGTGTCTGATTTTCTCGCAAAGCCTGATGGCCGAGGTCAG
TGTATTCAATCCGGCGCTTCTGGAAATCGACCATCAATCCGGAGTCGATATTCGCCAGTTTAATCGGGCAAACCTGATGC
CCCCAGGTGTTTATAGCGTTGATATTTTTATCAACGGTAAAATGTTTGAACGTCAGGATGTGACCTTTGTTCAGGATAAT
CCCGATGCTGATTTACACGCCTGCTTTGTCGCTATTAAAAAAACGCTAACCACCTTTGGCGTAAAAGTTGATGCGCTGAA
ATCGCTCAATGATGTAGATGAAACAGTCTGTATTGATCCTGGGCCACGCATTGAAGGCTCATCATGGCAGTTCGACAGCG
ATAAACTGCAACTGAATATCTCCATTCCCCAAATCTATATGGATGCGATGGCTTATGATTACATCAGCCCCTCGCGTTGG
GATGAGGGGATTAACGCGCTCACCATCAACTACGATTTTTCTGGTTCACATACTCTACGTTCGGATTATGGTTCACAAGA
GACAGATACCAGTTATCTCAATCTGCGCAATGGACTGAATATTGGGCCGTGGCGATTACGCAATTACAGCACCTTAAATA
CGACCGATGGCAGTGCAGAATACAACTCTATAAGCACCTGGATACAACGTGATATAGCTGCGTTAAGAAGCCAGATTATG
ATAGGTGATACGTGGACGGCGAGCGATATCTTCGACAGTACGCAAATTCGTGGCGCACGCTTGTATACCGATAACGATAT
GTTGCCTGCCAGCCAAAACGGATTTGCCCCCGTAGTGCGTGGGATTGCAAAGTCTAACGCCACTGTCATTATTCGCCAGA
ATGGCTACGTGATTTATCAGTCAGCCGTTCCACAAGGTGCTTTTGAAATTACCGACCTCAACACCGCCAGTACAGGTGGT
GATCTGGACGTAACCATCAAAGAAGAAGACGGTAGCGAACAACGATTTACTCAACCTTATGCGTCGTTAGCCATCCTCAA
ACGTGAAGGTCAAACTGATGTTGATGTCAGTGTGGGAGAATTACGCGATGAAGATGGCTTTACCCCTGACGTTATTCAGG
CTCAGATCCTTCATGGTTTTCCCTACGGTTTCACCTTGTATGGAGGTATGCAGGCTGCTGAAAAGTATGGTTCTGCCGCT
TTGGGTGTCGGTAAAGATCTTGGCGCATTGGGCGCAATTTCTTTCGATGTGACACATGCTCGCGCGAAATTTAGCCATGA
TGATACGGAAACCGGTCAGTCTTATCGCTTCCTGTACTCGAAACGCTTTGACGATACGGATACCAGCTTGCGCCTGGTTG
GCTATCGTTACTCCACCGAAGGTTATTATACCCTCAATGAATGGGCGTCCCGGCGTAATAATCCTGAAGATTTCTGGGAA
ACCGGTAACCGCCGCAGCCGTGTGGAAGGAACGTTAACGCAATCACTGGGCAGAGATTATGGCAACTTATATCTGACATT
AAGTCGCCAGCAGTACTGGCATACCGATGATGTTGAACGATTAATGCAATTTGGCTACAGCAGTAGCTGGAAGCGTCTCT
CGTGGAACGTCTCCTGGAGTTATTCCAATACTGCCCGGCAGGGGACGGGGAACAACCATGCCAGTGATAACACCAGTGAG
CAGATCTACATGCTCTCTTTATCTGTTCCTTTATCGGGCTGGTGGGGGAATAGTTACGCCACCTATTCTGTTTCACAAAA
CGATAATTCCGGTAGCTCACATCAACTTGGACTCAGCGGTACGGCGCTGGAAAGAAATAACCTTTCCTGGAATTTAATGC
AGTCCTATAACAGCCATGATGATGAGGTTGGCGGTAATATGTCCCTGACCTATGATGGCACTTATGGCACGGTGAACGGC
AGCTATAACTACAGCCAAAATTCTCAGAGGCTGAATTATGGTATCAGAGGGGGAATTCTGGCTCACAGCGAAGGCGTAAC
GTTAAGCCAGGAGTTGGGTGAAACCATAGCTCTTGTTAAAGCACCAGGGGCTGCCGGGTTAGAAATAGACAATATGCGTG
GTGCTGCGACGGACTGGCGTGGTTATACGGTCAAGACACAGCTAAACCCTTATGATGAAAACCGGGTAGCAATCAGCGAT
AACTATTTCTCGAAGTCGAATATAGAACTTGATAATACCGTCGTTACGATGGTTCCCACCCGTGGCGCGGTGGTTAAAGC
CGAATTTGTTACTCGTGTAGGTTATCGTGTGCTTTTCAGGGTGGCGGGTACAAAAGGTAAACCCGCACCTTTTGGCGCTA
TTGCTACAGTACAAAATACAAGCTCCGCTGATTCAGGGATTGTCGGTGACCTGGGGGAGCTTTATCTCTCTGGCCTTCCT
GAAAAGGGGCAAGTAATGCTCTCCTGGGGGGAAAATGCCGCCACTACATGCACCTTCGATTATTCAATTTCAATACCAGA
AAGTGAAAGCGGCTTAATTGAACAAGGTGTGACATGTCATTAA

Upstream 100 bases:

>100_bases
TGCGGGAGGCCAAATGATCTGGCGATTTATTAATGATTACGGCGCAGTCAGTGACCCGATAAAAATGACGCTGTAAGCAA
GGGAAAAGGATAGGCGTATT

Downstream 100 bases:

>100_bases
AAGGATTTTTATGAACAAGTATATTATACAGTGGTGCTTTACTGTTTTTATCTTCTCCTTTAGTGGTGCAACATTTGCGG
CCCCAAAAGGTATCTGCACC

Product: long polar fimbrial operon protein LpfC

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 840; Mature: 840

Protein sequence:

>840_residues
MMTTRIKVGLTAGTCLIFSQSLMAEVSVFNPALLEIDHQSGVDIRQFNRANLMPPGVYSVDIFINGKMFERQDVTFVQDN
PDADLHACFVAIKKTLTTFGVKVDALKSLNDVDETVCIDPGPRIEGSSWQFDSDKLQLNISIPQIYMDAMAYDYISPSRW
DEGINALTINYDFSGSHTLRSDYGSQETDTSYLNLRNGLNIGPWRLRNYSTLNTTDGSAEYNSISTWIQRDIAALRSQIM
IGDTWTASDIFDSTQIRGARLYTDNDMLPASQNGFAPVVRGIAKSNATVIIRQNGYVIYQSAVPQGAFEITDLNTASTGG
DLDVTIKEEDGSEQRFTQPYASLAILKREGQTDVDVSVGELRDEDGFTPDVIQAQILHGFPYGFTLYGGMQAAEKYGSAA
LGVGKDLGALGAISFDVTHARAKFSHDDTETGQSYRFLYSKRFDDTDTSLRLVGYRYSTEGYYTLNEWASRRNNPEDFWE
TGNRRSRVEGTLTQSLGRDYGNLYLTLSRQQYWHTDDVERLMQFGYSSSWKRLSWNVSWSYSNTARQGTGNNHASDNTSE
QIYMLSLSVPLSGWWGNSYATYSVSQNDNSGSSHQLGLSGTALERNNLSWNLMQSYNSHDDEVGGNMSLTYDGTYGTVNG
SYNYSQNSQRLNYGIRGGILAHSEGVTLSQELGETIALVKAPGAAGLEIDNMRGAATDWRGYTVKTQLNPYDENRVAISD
NYFSKSNIELDNTVVTMVPTRGAVVKAEFVTRVGYRVLFRVAGTKGKPAPFGAIATVQNTSSADSGIVGDLGELYLSGLP
EKGQVMLSWGENAATTCTFDYSISIPESESGLIEQGVTCH

Sequences:

>Translated_840_residues
MMTTRIKVGLTAGTCLIFSQSLMAEVSVFNPALLEIDHQSGVDIRQFNRANLMPPGVYSVDIFINGKMFERQDVTFVQDN
PDADLHACFVAIKKTLTTFGVKVDALKSLNDVDETVCIDPGPRIEGSSWQFDSDKLQLNISIPQIYMDAMAYDYISPSRW
DEGINALTINYDFSGSHTLRSDYGSQETDTSYLNLRNGLNIGPWRLRNYSTLNTTDGSAEYNSISTWIQRDIAALRSQIM
IGDTWTASDIFDSTQIRGARLYTDNDMLPASQNGFAPVVRGIAKSNATVIIRQNGYVIYQSAVPQGAFEITDLNTASTGG
DLDVTIKEEDGSEQRFTQPYASLAILKREGQTDVDVSVGELRDEDGFTPDVIQAQILHGFPYGFTLYGGMQAAEKYGSAA
LGVGKDLGALGAISFDVTHARAKFSHDDTETGQSYRFLYSKRFDDTDTSLRLVGYRYSTEGYYTLNEWASRRNNPEDFWE
TGNRRSRVEGTLTQSLGRDYGNLYLTLSRQQYWHTDDVERLMQFGYSSSWKRLSWNVSWSYSNTARQGTGNNHASDNTSE
QIYMLSLSVPLSGWWGNSYATYSVSQNDNSGSSHQLGLSGTALERNNLSWNLMQSYNSHDDEVGGNMSLTYDGTYGTVNG
SYNYSQNSQRLNYGIRGGILAHSEGVTLSQELGETIALVKAPGAAGLEIDNMRGAATDWRGYTVKTQLNPYDENRVAISD
NYFSKSNIELDNTVVTMVPTRGAVVKAEFVTRVGYRVLFRVAGTKGKPAPFGAIATVQNTSSADSGIVGDLGELYLSGLP
EKGQVMLSWGENAATTCTFDYSISIPESESGLIEQGVTCH
>Mature_840_residues
MMTTRIKVGLTAGTCLIFSQSLMAEVSVFNPALLEIDHQSGVDIRQFNRANLMPPGVYSVDIFINGKMFERQDVTFVQDN
PDADLHACFVAIKKTLTTFGVKVDALKSLNDVDETVCIDPGPRIEGSSWQFDSDKLQLNISIPQIYMDAMAYDYISPSRW
DEGINALTINYDFSGSHTLRSDYGSQETDTSYLNLRNGLNIGPWRLRNYSTLNTTDGSAEYNSISTWIQRDIAALRSQIM
IGDTWTASDIFDSTQIRGARLYTDNDMLPASQNGFAPVVRGIAKSNATVIIRQNGYVIYQSAVPQGAFEITDLNTASTGG
DLDVTIKEEDGSEQRFTQPYASLAILKREGQTDVDVSVGELRDEDGFTPDVIQAQILHGFPYGFTLYGGMQAAEKYGSAA
LGVGKDLGALGAISFDVTHARAKFSHDDTETGQSYRFLYSKRFDDTDTSLRLVGYRYSTEGYYTLNEWASRRNNPEDFWE
TGNRRSRVEGTLTQSLGRDYGNLYLTLSRQQYWHTDDVERLMQFGYSSSWKRLSWNVSWSYSNTARQGTGNNHASDNTSE
QIYMLSLSVPLSGWWGNSYATYSVSQNDNSGSSHQLGLSGTALERNNLSWNLMQSYNSHDDEVGGNMSLTYDGTYGTVNG
SYNYSQNSQRLNYGIRGGILAHSEGVTLSQELGETIALVKAPGAAGLEIDNMRGAATDWRGYTVKTQLNPYDENRVAISD
NYFSKSNIELDNTVVTMVPTRGAVVKAEFVTRVGYRVLFRVAGTKGKPAPFGAIATVQNTSSADSGIVGDLGELYLSGLP
EKGQVMLSWGENAATTCTFDYSISIPESESGLIEQGVTCH

Specific function: Involved in the export and assembly of lpfA fimbrial subunits across the outer membrane [H]

COG id: COG3188

COG function: function code NU; P pilus assembly protein, porin PapC

Gene ontology:

Cell location: Cell outer membrane; Multi-pass membrane protein [H]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the fimbrial export usher family [H]

Homologues:

Organism=Escherichia coli, GI1787172, Length=863, Percent_Identity=39.3974507531866, Blast_Score=609, Evalue=1e-175,
Organism=Escherichia coli, GI1790772, Length=858, Percent_Identity=39.1608391608392, Blast_Score=600, Evalue=1e-173,
Organism=Escherichia coli, GI1786744, Length=869, Percent_Identity=37.6294591484465, Blast_Score=566, Evalue=1e-162,
Organism=Escherichia coli, GI1789533, Length=828, Percent_Identity=38.768115942029, Blast_Score=529, Evalue=1e-151,
Organism=Escherichia coli, GI1786332, Length=867, Percent_Identity=32.5259515570934, Blast_Score=400, Evalue=1e-112,
Organism=Escherichia coli, GI1788427, Length=804, Percent_Identity=29.9751243781095, Blast_Score=342, Evalue=4e-95,
Organism=Escherichia coli, GI87081778, Length=855, Percent_Identity=28.5380116959064, Blast_Score=259, Evalue=5e-70,
Organism=Escherichia coli, GI1789610, Length=758, Percent_Identity=24.4063324538259, Blast_Score=120, Evalue=3e-28,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR000015
- InterPro:   IPR018030 [H]

Pfam domain/function: PF00577 Usher [H]

EC number: NA

Molecular weight: Translated: 92732; Mature: 92732

Theoretical pI: Translated: 4.58; Mature: 4.58

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.6 %Cys     (Translated Protein)
2.0 %Met     (Translated Protein)
2.6 %Cys+Met (Translated Protein)
0.6 %Cys     (Mature Protein)
2.0 %Met     (Mature Protein)
2.6 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MMTTRIKVGLTAGTCLIFSQSLMAEVSVFNPALLEIDHQSGVDIRQFNRANLMPPGVYSV
CCEEEEEEEEECCCCEEHHHHHHHHHHHCCCEEEEEECCCCCCHHHCCCCCCCCCCCEEE
DIFINGKMFERQDVTFVQDNPDADLHACFVAIKKTLTTFGVKVDALKSLNDVDETVCIDP
EEEECCEEECCCCCEEEECCCCCHHHHHHHHHHHHHHHHCEEHHHHHHCCCCCCEEEECC
GPRIEGSSWQFDSDKLQLNISIPQIYMDAMAYDYISPSRWDEGINALTINYDFSGSHTLR
CCCCCCCCEEECCCEEEEEEECHHHHHHHHHHHCCCCHHHCCCCCEEEEEEECCCCCCHH
SDYGSQETDTSYLNLRNGLNIGPWRLRNYSTLNTTDGSAEYNSISTWIQRDIAALRSQIM
HCCCCCCCCCCEEEECCCCCCCCEEECCCEEECCCCCCCCHHHHHHHHHHHHHHHHCEEE
IGDTWTASDIFDSTQIRGARLYTDNDMLPASQNGFAPVVRGIAKSNATVIIRQNGYVIYQ
ECCCCCHHHHCCCCCCCCEEEEECCCCCCCCCCCCHHHHHHHHCCCCEEEEECCCEEEEE
SAVPQGAFEITDLNTASTGGDLDVTIKEEDGSEQRFTQPYASLAILKREGQTDVDVSVGE
CCCCCCCEEEEECCCCCCCCCEEEEEECCCCCCHHHHCHHHHEEEEECCCCCCCEEEHHC
LRDEDGFTPDVIQAQILHGFPYGFTLYGGMQAAEKYGSAALGVGKDLGALGAISFDVTHA
CCCCCCCCHHHHHHHHHHCCCCCEEEECCHHHHHHHCCEEECCCCCCCCCEEEEEEEEEE
RAKFSHDDTETGQSYRFLYSKRFDDTDTSLRLVGYRYSTEGYYTLNEWASRRNNPEDFWE
EEECCCCCCCCCCCEEEEEECCCCCCCCEEEEEEEEECCCCEEEHHHHHHCCCCCHHHHH
TGNRRSRVEGTLTQSLGRDYGNLYLTLSRQQYWHTDDVERLMQFGYSSSWKRLSWNVSWS
CCCCCCHHHHHHHHHHCCCCCEEEEEEECCCCCCHHHHHHHHHCCCCCCCEEEEEEEEEE
YSNTARQGTGNNHASDNTSEQIYMLSLSVPLSGWWGNSYATYSVSQNDNSGSSHQLGLSG
ECCCCCCCCCCCCCCCCCCCEEEEEEEECCCCCCCCCCEEEEEECCCCCCCCCEEECCCC
TALERNNLSWNLMQSYNSHDDEVGGNMSLTYDGTYGTVNGSYNYSQNSQRLNYGIRGGIL
CEEECCCCCEEEHHHCCCCCCCCCCCEEEEECCCEEEECCCCCCCCCCCEEECCCCCCEE
AHSEGVTLSQELGETIALVKAPGAAGLEIDNMRGAATDWRGYTVKTQLNPYDENRVAISD
EECCCCEEHHHHCCEEEEEECCCCCCCEECCCCCCCCCCCCEEEEEECCCCCCCEEEEEC
NYFSKSNIELDNTVVTMVPTRGAVVKAEFVTRVGYRVLFRVAGTKGKPAPFGAIATVQNT
CCCCCCCCEECCEEEEEECCCCCEEEHHHHHHHHHEEEEEEECCCCCCCCCCEEEEEECC
SSADSGIVGDLGELYLSGLPEKGQVMLSWGENAATTCTFDYSISIPESESGLIEQGVTCH
CCCCCCCCCCHHHHHHCCCCCCCCEEEEECCCCEEEEEEEEEEECCCCCCCHHHCCCCCC
>Mature Secondary Structure
MMTTRIKVGLTAGTCLIFSQSLMAEVSVFNPALLEIDHQSGVDIRQFNRANLMPPGVYSV
CCEEEEEEEEECCCCEEHHHHHHHHHHHCCCEEEEEECCCCCCHHHCCCCCCCCCCCEEE
DIFINGKMFERQDVTFVQDNPDADLHACFVAIKKTLTTFGVKVDALKSLNDVDETVCIDP
EEEECCEEECCCCCEEEECCCCCHHHHHHHHHHHHHHHHCEEHHHHHHCCCCCCEEEECC
GPRIEGSSWQFDSDKLQLNISIPQIYMDAMAYDYISPSRWDEGINALTINYDFSGSHTLR
CCCCCCCCEEECCCEEEEEEECHHHHHHHHHHHCCCCHHHCCCCCEEEEEEECCCCCCHH
SDYGSQETDTSYLNLRNGLNIGPWRLRNYSTLNTTDGSAEYNSISTWIQRDIAALRSQIM
HCCCCCCCCCCEEEECCCCCCCCEEECCCEEECCCCCCCCHHHHHHHHHHHHHHHHCEEE
IGDTWTASDIFDSTQIRGARLYTDNDMLPASQNGFAPVVRGIAKSNATVIIRQNGYVIYQ
ECCCCCHHHHCCCCCCCCEEEEECCCCCCCCCCCCHHHHHHHHCCCCEEEEECCCEEEEE
SAVPQGAFEITDLNTASTGGDLDVTIKEEDGSEQRFTQPYASLAILKREGQTDVDVSVGE
CCCCCCCEEEEECCCCCCCCCEEEEEECCCCCCHHHHCHHHHEEEEECCCCCCCEEEHHC
LRDEDGFTPDVIQAQILHGFPYGFTLYGGMQAAEKYGSAALGVGKDLGALGAISFDVTHA
CCCCCCCCHHHHHHHHHHCCCCCEEEECCHHHHHHHCCEEECCCCCCCCCEEEEEEEEEE
RAKFSHDDTETGQSYRFLYSKRFDDTDTSLRLVGYRYSTEGYYTLNEWASRRNNPEDFWE
EEECCCCCCCCCCCEEEEEECCCCCCCCEEEEEEEEECCCCEEEHHHHHHCCCCCHHHHH
TGNRRSRVEGTLTQSLGRDYGNLYLTLSRQQYWHTDDVERLMQFGYSSSWKRLSWNVSWS
CCCCCCHHHHHHHHHHCCCCCEEEEEEECCCCCCHHHHHHHHHCCCCCCCEEEEEEEEEE
YSNTARQGTGNNHASDNTSEQIYMLSLSVPLSGWWGNSYATYSVSQNDNSGSSHQLGLSG
ECCCCCCCCCCCCCCCCCCCEEEEEEEECCCCCCCCCCEEEEEECCCCCCCCCEEECCCC
TALERNNLSWNLMQSYNSHDDEVGGNMSLTYDGTYGTVNGSYNYSQNSQRLNYGIRGGIL
CEEECCCCCEEEHHHCCCCCCCCCCCEEEEECCCEEEECCCCCCCCCCCEEECCCCCCEE
AHSEGVTLSQELGETIALVKAPGAAGLEIDNMRGAATDWRGYTVKTQLNPYDENRVAISD
EECCCCEEHHHHCCEEEEEECCCCCCCEECCCCCCCCCCCCEEEEEECCCCCCCEEEEEC
NYFSKSNIELDNTVVTMVPTRGAVVKAEFVTRVGYRVLFRVAGTKGKPAPFGAIATVQNT
CCCCCCCCEECCEEEEEECCCCCEEEHHHHHHHHHEEEEEEECCCCCCCCCCEEEEEECC
SSADSGIVGDLGELYLSGLPEKGQVMLSWGENAATTCTFDYSISIPESESGLIEQGVTCH
CCCCCCCCCCHHHHHHCCCCCCCCEEEEECCCCEEEEEEEEEEECCCCCCCHHHCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 7721701; 11677609 [H]