| Definition | Escherichia coli O157:H7 str. EC4115, complete genome. |
|---|---|
| Accession | NC_011353 |
| Length | 5,572,075 |
Click here to switch to the map view.
The map label for this gene is lpfC [H]
Identifier: 209397496
GI number: 209397496
Start: 4803732
End: 4806266
Strand: Reverse
Name: lpfC [H]
Synonym: ECH74115_5161
Alternate gene names: 209397496
Gene position: 4806266-4803732 (Counterclockwise)
Preceding gene: 209400508
Following gene: 209395769
Centisome position: 86.26
GC content: 48.48
Gene sequence:
>2535_bases ATGGCCTCTTCGCATCTTTTCATTACGCTTGCATCGGGCATATGTCTGCTCTGTTCCATATCTGCTTTTGCCCGGGATAG CTTGTTCAACCCCAGATTACTGGAACTGGATCATCCTGCGGATAATATTGATATTCACCAGTTCAACCGTTCGAATACCT TACCTGCGGGAACATACAAAGTTGATGTGATGATCAACGGCATGCTCTTCGAACGCCAGGAAGTTAAATTCGCCCAGGAT AACCCTGATGCTGAACTCCACCCATGCTACGTGGCGATAAAAAACGTGCTGGCGACCTATGGTATAAAAGTTGATGCGAT AAAATCTCTGGCGAATGTTGATGACAAAACATGCGTAAATCCAGTTCCGCTGATCGACGGGGCTACCTGGTTACTGGACG CCAGTAAACTTGCATTGAATATTACTATTCCGCAAATTTATCTCAACAATGCAGTTAATGGTTATATCAGCCCTTCCCGT TGGGATCAGGGGATCAATGCCATGATGATGAATTATGATTTTTCGGCATCGCATACCATCCGGTCAAATTATGACGACGA CGATGACAGTTATTATCTGAATTTGCGTAATGGTATTAATTTAGGCGCATGGCGTTTTCGTAATTACAGCACCCTGAATT CTTATGACGGTAATGTGGACTACCATTCCGTCAGTAATTACATTCAGCGCGACATCATGGCATTACGTAGCCAGATTATG ATTGGCGATACCTGGACGGCAAGCGATGTATTTGATAGTACACAGGTGCGTGGCGTGCGGCTGTATACCGATGACGATAT GTTGCCCTCCAGCCAGAACGGCTTTGCGCCAGTGGTACATGGGATTGCGAAAACTAACGCCACGGTGATCATCAAACAAA ACGGCTACGTTATTTATCAATCAGCCGTACCACAGGGCGCATTTGCCCTCACCGACTTAAACACGACCAGTAGCGGCGGC GATCTCGATGTCACTATCAAAGAAGAAGATGGCAGCGAGCAGCACTTTATTCAGCCATTTACTTCACTGGCCATTCTCAA GCGTGAAGGTCAGACCGATGTAGACCTTAGCATTGGAGAAGTGCGCGACGAAAGCGGCTTTACGCCTGAGGTCTTGCAGT TACAAGCAATGCACGGTTTCCCTTTGGGAATAACTTTGTATGGCGGAACACAATTGGCAAATGATTACGCTTCTGCCGCG CTGGGTATTGGTAAAGATATGGGGGCGCTGGGCGCGATTTCTTTTGACGTGACTCATGCCCGCTCGCAGTTTGACTACGA CGATAATGAGAGTGGTCAATCGTATCGTTTTCTCTATTCCAAACGTTTTGAAGACACCAATACCACCTTTCGTCTGGTGG GTTATCGCTACTCTATGGAGGGGTTCTACACCCTCAATGAATGGGTGTCGCGACAGGATAATGATTCTGATTTCTGGGTA ACGGGCAACCGTCGCAGCCGCTTCGAAGGTACCTGGACGCAATCTTTCACGCCAGGCTGGGGCAATATTTATTTAACATT CAGTCGACAGGAATACTGGCAGACCGATGAGGTCGAACGTTTATTACAGTTCGGCTATAACAACAACTGGCGAAACATCT CCTGGAACGTTTCCTGGAACTATACGGACTCGATCAAGCGCTCATTGGGCAACCATCATGATGATAACAATGATGATTTC GGCAAAGAACAGATTTTCATGTTCTCAATGTCGATACCGCTATCGTGCTGGATGGAAGACAGCTACGTCAACTATTCGTT AACGCAAAACAACCACCATGAAAGCACGATGCAGGTCGGTCTGAACGGAACGATGCTGGAAGGGCGTAACCTGTCTTATA ACGTACAGGAATCGTGGATGCACTCTCCTGATGACTCCTACAGCGGCAATGCCGGAATGACCTATGACGGGACTTATGGC TCGGTCAATGGTAGCTATTCCTGGAGCCGTGACTCCCAACATTTTGATTATGGCGCCAGAGGCGGCGTGCTGGTGCATAG TGACGGAGTGACCTTCTCGCAGGAACTGGGCGAAACGGTGGCATTGGTCAAAGCGCCGGGCGCAGAAGGCCTGTCCATTG AAAACGCCACCGGGATTTCTACCGACTGGCGTGGTTATACCGTAAAAACGCAGCTTAGCCCGTATGACGAAAACCGCGTG GCATTGAACAGCGACTATTTCTCCAAAGCCAATATTGAACTGGAAAACACCGTCATCAACCTGGTACCAACGCGCGGTGC GGTGGTGAAAGCCGAATTTGTCACCCATGTCGGTTATCGCGTGCTATTTAACGTCCGCCAGGTCAACGGTAAACCAATAA TGTTTGGCGCGATGGCAACCGCCTCTCTCGAAACGGGCACAGTCACCGGGATTGTCGGTGATAACGGCGAACTGTATCTC TCCGGGATGCCTGAAAAAGGCGAGTTTTTATTGAGTTGGGGACAAGCTGCGGATGAAAAATGTAAGGCGGCCTATCACAT CACCCATAAACCTGATGATACCAGCCTGGTTCAAATGGATGCGATTTGTCGCTAA
Upstream 100 bases:
>100_bases CGTGGCAGGAAAATCGCTCGTTTGGCGCTTTATTAATGATTACGGTGCAATTAGTCAACCACTAAAGAAAAACCTTTAAG CGCCGGATAAGGATATATCG
Downstream 100 bases:
>100_bases AGGAAGCATGAATGAAAAAAATATTATCAGGGTTGATTCTGCTGCTTTGCTGTCCTTATGGTTTCGCCGCTAATGGTGAT GGCGCAACGCACATGTCAAA
Product: fimbrial usher protein
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 844; Mature: 843
Protein sequence:
>844_residues MASSHLFITLASGICLLCSISAFARDSLFNPRLLELDHPADNIDIHQFNRSNTLPAGTYKVDVMINGMLFERQEVKFAQD NPDAELHPCYVAIKNVLATYGIKVDAIKSLANVDDKTCVNPVPLIDGATWLLDASKLALNITIPQIYLNNAVNGYISPSR WDQGINAMMMNYDFSASHTIRSNYDDDDDSYYLNLRNGINLGAWRFRNYSTLNSYDGNVDYHSVSNYIQRDIMALRSQIM IGDTWTASDVFDSTQVRGVRLYTDDDMLPSSQNGFAPVVHGIAKTNATVIIKQNGYVIYQSAVPQGAFALTDLNTTSSGG DLDVTIKEEDGSEQHFIQPFTSLAILKREGQTDVDLSIGEVRDESGFTPEVLQLQAMHGFPLGITLYGGTQLANDYASAA LGIGKDMGALGAISFDVTHARSQFDYDDNESGQSYRFLYSKRFEDTNTTFRLVGYRYSMEGFYTLNEWVSRQDNDSDFWV TGNRRSRFEGTWTQSFTPGWGNIYLTFSRQEYWQTDEVERLLQFGYNNNWRNISWNVSWNYTDSIKRSLGNHHDDNNDDF GKEQIFMFSMSIPLSCWMEDSYVNYSLTQNNHHESTMQVGLNGTMLEGRNLSYNVQESWMHSPDDSYSGNAGMTYDGTYG SVNGSYSWSRDSQHFDYGARGGVLVHSDGVTFSQELGETVALVKAPGAEGLSIENATGISTDWRGYTVKTQLSPYDENRV ALNSDYFSKANIELENTVINLVPTRGAVVKAEFVTHVGYRVLFNVRQVNGKPIMFGAMATASLETGTVTGIVGDNGELYL SGMPEKGEFLLSWGQAADEKCKAAYHITHKPDDTSLVQMDAICR
Sequences:
>Translated_844_residues MASSHLFITLASGICLLCSISAFARDSLFNPRLLELDHPADNIDIHQFNRSNTLPAGTYKVDVMINGMLFERQEVKFAQD NPDAELHPCYVAIKNVLATYGIKVDAIKSLANVDDKTCVNPVPLIDGATWLLDASKLALNITIPQIYLNNAVNGYISPSR WDQGINAMMMNYDFSASHTIRSNYDDDDDSYYLNLRNGINLGAWRFRNYSTLNSYDGNVDYHSVSNYIQRDIMALRSQIM IGDTWTASDVFDSTQVRGVRLYTDDDMLPSSQNGFAPVVHGIAKTNATVIIKQNGYVIYQSAVPQGAFALTDLNTTSSGG DLDVTIKEEDGSEQHFIQPFTSLAILKREGQTDVDLSIGEVRDESGFTPEVLQLQAMHGFPLGITLYGGTQLANDYASAA LGIGKDMGALGAISFDVTHARSQFDYDDNESGQSYRFLYSKRFEDTNTTFRLVGYRYSMEGFYTLNEWVSRQDNDSDFWV TGNRRSRFEGTWTQSFTPGWGNIYLTFSRQEYWQTDEVERLLQFGYNNNWRNISWNVSWNYTDSIKRSLGNHHDDNNDDF GKEQIFMFSMSIPLSCWMEDSYVNYSLTQNNHHESTMQVGLNGTMLEGRNLSYNVQESWMHSPDDSYSGNAGMTYDGTYG SVNGSYSWSRDSQHFDYGARGGVLVHSDGVTFSQELGETVALVKAPGAEGLSIENATGISTDWRGYTVKTQLSPYDENRV ALNSDYFSKANIELENTVINLVPTRGAVVKAEFVTHVGYRVLFNVRQVNGKPIMFGAMATASLETGTVTGIVGDNGELYL SGMPEKGEFLLSWGQAADEKCKAAYHITHKPDDTSLVQMDAICR >Mature_843_residues ASSHLFITLASGICLLCSISAFARDSLFNPRLLELDHPADNIDIHQFNRSNTLPAGTYKVDVMINGMLFERQEVKFAQDN PDAELHPCYVAIKNVLATYGIKVDAIKSLANVDDKTCVNPVPLIDGATWLLDASKLALNITIPQIYLNNAVNGYISPSRW DQGINAMMMNYDFSASHTIRSNYDDDDDSYYLNLRNGINLGAWRFRNYSTLNSYDGNVDYHSVSNYIQRDIMALRSQIMI GDTWTASDVFDSTQVRGVRLYTDDDMLPSSQNGFAPVVHGIAKTNATVIIKQNGYVIYQSAVPQGAFALTDLNTTSSGGD LDVTIKEEDGSEQHFIQPFTSLAILKREGQTDVDLSIGEVRDESGFTPEVLQLQAMHGFPLGITLYGGTQLANDYASAAL GIGKDMGALGAISFDVTHARSQFDYDDNESGQSYRFLYSKRFEDTNTTFRLVGYRYSMEGFYTLNEWVSRQDNDSDFWVT GNRRSRFEGTWTQSFTPGWGNIYLTFSRQEYWQTDEVERLLQFGYNNNWRNISWNVSWNYTDSIKRSLGNHHDDNNDDFG KEQIFMFSMSIPLSCWMEDSYVNYSLTQNNHHESTMQVGLNGTMLEGRNLSYNVQESWMHSPDDSYSGNAGMTYDGTYGS VNGSYSWSRDSQHFDYGARGGVLVHSDGVTFSQELGETVALVKAPGAEGLSIENATGISTDWRGYTVKTQLSPYDENRVA LNSDYFSKANIELENTVINLVPTRGAVVKAEFVTHVGYRVLFNVRQVNGKPIMFGAMATASLETGTVTGIVGDNGELYLS GMPEKGEFLLSWGQAADEKCKAAYHITHKPDDTSLVQMDAICR
Specific function: Involved in the export and assembly of lpfA fimbrial subunits across the outer membrane [H]
COG id: COG3188
COG function: function code NU; P pilus assembly protein, porin PapC
Gene ontology:
Cell location: Cell outer membrane; Multi-pass membrane protein [H]
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the fimbrial export usher family [H]
Homologues:
Organism=Escherichia coli, GI1787172, Length=869, Percent_Identity=37.9746835443038, Blast_Score=590, Evalue=1e-169, Organism=Escherichia coli, GI1790772, Length=874, Percent_Identity=37.7574370709382, Blast_Score=587, Evalue=1e-169, Organism=Escherichia coli, GI1786744, Length=875, Percent_Identity=37.1428571428571, Blast_Score=573, Evalue=1e-164, Organism=Escherichia coli, GI1789533, Length=848, Percent_Identity=36.6745283018868, Blast_Score=506, Evalue=1e-144, Organism=Escherichia coli, GI1786332, Length=872, Percent_Identity=31.7660550458716, Blast_Score=378, Evalue=1e-106, Organism=Escherichia coli, GI1788427, Length=816, Percent_Identity=29.7794117647059, Blast_Score=332, Evalue=4e-92, Organism=Escherichia coli, GI87081778, Length=859, Percent_Identity=30.7334109429569, Blast_Score=268, Evalue=1e-72, Organism=Escherichia coli, GI1789610, Length=803, Percent_Identity=25.4047322540473, Blast_Score=132, Evalue=1e-31,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR000015 - InterPro: IPR018030 [H]
Pfam domain/function: PF00577 Usher [H]
EC number: NA
Molecular weight: Translated: 94346; Mature: 94215
Theoretical pI: Translated: 4.54; Mature: 4.54
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.8 %Cys (Translated Protein) 2.7 %Met (Translated Protein) 3.6 %Cys+Met (Translated Protein) 0.8 %Cys (Mature Protein) 2.6 %Met (Mature Protein) 3.4 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MASSHLFITLASGICLLCSISAFARDSLFNPRLLELDHPADNIDIHQFNRSNTLPAGTYK CCCCEEEEEECCCHHEEHHHHHHHHHCCCCCEEEEECCCCCCCEEEEECCCCCCCCCEEE VDVMINGMLFERQEVKFAQDNPDAELHPCYVAIKNVLATYGIKVDAIKSLANVDDKTCVN EEEEEECEEEECCCCEEECCCCCCCCCHHHHHHHHHHHHCCCCHHHHHHHHCCCCCCCCC PVPLIDGATWLLDASKLALNITIPQIYLNNAVNGYISPSRWDQGINAMMMNYDFSASHTI CCCCCCCCEEEEECCEEEEEEEECEEEECCCCCCCCCHHHHCCCCEEEEEEECCCCCCEE RSNYDDDDDSYYLNLRNGINLGAWRFRNYSTLNSYDGNVDYHSVSNYIQRDIMALRSQIM CCCCCCCCCCEEEEECCCCCCCEEEECCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHEE IGDTWTASDVFDSTQVRGVRLYTDDDMLPSSQNGFAPVVHGIAKTNATVIIKQNGYVIYQ ECCCCCCHHHCCCCCCCEEEEEECCCCCCCCCCCCHHHHHHHHCCCCEEEEECCCEEEEE SAVPQGAFALTDLNTTSSGGDLDVTIKEEDGSEQHFIQPFTSLAILKREGQTDVDLSIGE CCCCCCCEEEEECCCCCCCCEEEEEEECCCCCCCHHHHHHHHHHHEECCCCCCCEEEECC VRDESGFTPEVLQLQAMHGFPLGITLYGGTQLANDYASAALGIGKDMGALGAISFDVTHA CCCCCCCCHHHEEEEECCCCCEEEEEECCCHHHHHHHHHHHCCCCCCCCCEEEEEEEEHH RSQFDYDDNESGQSYRFLYSKRFEDTNTTFRLVGYRYSMEGFYTLNEWVSRQDNDSDFWV HHCCCCCCCCCCCEEEEEEEECCCCCCCEEEEEEEEEECCCEEEHHHHHCCCCCCCCEEE TGNRRSRFEGTWTQSFTPGWGNIYLTFSRQEYWQTDEVERLLQFGYNNNWRNISWNVSWN ECCCCCCCCCCCCCCCCCCCCEEEEEECCHHHCCHHHHHHHHHCCCCCCCCEEEEEEEEC YTDSIKRSLGNHHDDNNDDFGKEQIFMFSMSIPLSCWMEDSYVNYSLTQNNHHESTMQVG CHHHHHHHHCCCCCCCCCCCCCCEEEEEEECCCEEEEEECCEEEEEEECCCCCCCEEEEC LNGTMLEGRNLSYNVQESWMHSPDDSYSGNAGMTYDGTYGSVNGSYSWSRDSQHFDYGAR CCCEEEECCCCEEEHHHHHCCCCCCCCCCCCCEEECCCCCCCCCCCCCCCCCCCCCCCCC GGVLVHSDGVTFSQELGETVALVKAPGAEGLSIENATGISTDWRGYTVKTQLSPYDENRV CCEEEEECCCEEHHHCCCEEEEEECCCCCCCEECCCCCCCCCCCCEEEEEECCCCCCCEE ALNSDYFSKANIELENTVINLVPTRGAVVKAEFVTHVGYRVLFNVRQVNGKPIMFGAMAT EECCCCCCCCCEEEECEEEEEEECCCCEEEEHHHHHCCEEEEEEEEECCCCEEEEEEEEE ASLETGTVTGIVGDNGELYLSGMPEKGEFLLSWGQAADEKCKAAYHITHKPDDTSLVQMD CEECCCEEEEEECCCCEEEEECCCCCCCEEEEECCCCCCCCCEEEEEECCCCCCCEEEEC AICR CCCC >Mature Secondary Structure ASSHLFITLASGICLLCSISAFARDSLFNPRLLELDHPADNIDIHQFNRSNTLPAGTYK CCCEEEEEECCCHHEEHHHHHHHHHCCCCCEEEEECCCCCCCEEEEECCCCCCCCCEEE VDVMINGMLFERQEVKFAQDNPDAELHPCYVAIKNVLATYGIKVDAIKSLANVDDKTCVN EEEEEECEEEECCCCEEECCCCCCCCCHHHHHHHHHHHHCCCCHHHHHHHHCCCCCCCCC PVPLIDGATWLLDASKLALNITIPQIYLNNAVNGYISPSRWDQGINAMMMNYDFSASHTI CCCCCCCCEEEEECCEEEEEEEECEEEECCCCCCCCCHHHHCCCCEEEEEEECCCCCCEE RSNYDDDDDSYYLNLRNGINLGAWRFRNYSTLNSYDGNVDYHSVSNYIQRDIMALRSQIM CCCCCCCCCCEEEEECCCCCCCEEEECCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHEE IGDTWTASDVFDSTQVRGVRLYTDDDMLPSSQNGFAPVVHGIAKTNATVIIKQNGYVIYQ ECCCCCCHHHCCCCCCCEEEEEECCCCCCCCCCCCHHHHHHHHCCCCEEEEECCCEEEEE SAVPQGAFALTDLNTTSSGGDLDVTIKEEDGSEQHFIQPFTSLAILKREGQTDVDLSIGE CCCCCCCEEEEECCCCCCCCEEEEEEECCCCCCCHHHHHHHHHHHEECCCCCCCEEEECC VRDESGFTPEVLQLQAMHGFPLGITLYGGTQLANDYASAALGIGKDMGALGAISFDVTHA CCCCCCCCHHHEEEEECCCCCEEEEEECCCHHHHHHHHHHHCCCCCCCCCEEEEEEEEHH RSQFDYDDNESGQSYRFLYSKRFEDTNTTFRLVGYRYSMEGFYTLNEWVSRQDNDSDFWV HHCCCCCCCCCCCEEEEEEEECCCCCCCEEEEEEEEEECCCEEEHHHHHCCCCCCCCEEE TGNRRSRFEGTWTQSFTPGWGNIYLTFSRQEYWQTDEVERLLQFGYNNNWRNISWNVSWN ECCCCCCCCCCCCCCCCCCCCEEEEEECCHHHCCHHHHHHHHHCCCCCCCCEEEEEEEEC YTDSIKRSLGNHHDDNNDDFGKEQIFMFSMSIPLSCWMEDSYVNYSLTQNNHHESTMQVG CHHHHHHHHCCCCCCCCCCCCCCEEEEEEECCCEEEEEECCEEEEEEECCCCCCCEEEEC LNGTMLEGRNLSYNVQESWMHSPDDSYSGNAGMTYDGTYGSVNGSYSWSRDSQHFDYGAR CCCEEEECCCCEEEHHHHHCCCCCCCCCCCCCEEECCCCCCCCCCCCCCCCCCCCCCCCC GGVLVHSDGVTFSQELGETVALVKAPGAEGLSIENATGISTDWRGYTVKTQLSPYDENRV CCEEEEECCCEEHHHCCCEEEEEECCCCCCCEECCCCCCCCCCCCEEEEEECCCCCCCEE ALNSDYFSKANIELENTVINLVPTRGAVVKAEFVTHVGYRVLFNVRQVNGKPIMFGAMAT EECCCCCCCCCEEEECEEEEEEECCCCEEEEHHHHHCCEEEEEEEEECCCCEEEEEEEEE ASLETGTVTGIVGDNGELYLSGMPEKGEFLLSWGQAADEKCKAAYHITHKPDDTSLVQMD CEECCCEEEEEECCCCEEEEECCCCCCCEEEEECCCCCCCCCEEEEEECCCCCCCEEEEC AICR CCCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 6.0
TargetDB status: NA
Availability: NA
References: 7721701; 11677609 [H]