| Definition | Escherichia coli O157:H7 str. EC4115, complete genome. |
|---|---|
| Accession | NC_011353 |
| Length | 5,572,075 |
Click here to switch to the map view.
The map label for this gene is pgaA
Identifier: 209397134
GI number: 209397134
Start: 1275095
End: 1277518
Strand: Reverse
Name: pgaA
Synonym: ECH74115_1266
Alternate gene names: 209397134
Gene position: 1277518-1275095 (Counterclockwise)
Preceding gene: 209400320
Following gene: 209397733
Centisome position: 22.93
GC content: 47.32
Gene sequence:
>2424_bases ATGTATTCAAGTAGCAGAAAAAGGTGCCCGAAAACCAAATGGGCTTTGAAACTTCTTACTGCCGCATTTTTAGCAGCGAG TCCCGCGGCGAAGAGTGCTGTTAATAACGCCTATGATGCATTGATTATTGAAGCTCGCAAGGGTAATACTCAGCCAGCTT TGTCATGGTTTGCACTAAAATCAGCACTCAGCAATAACCAAATTGCTGACTGGTTACAGATTGCCTTATGGGCCGGGCAA GATAAACAGGTTATTACCGTTTACAACCGCTACCGTCATCAGCAATTACCAGCGCGTGGTTATGCAGCTGTCGCCGTCGC TTATCGTAACCTGCAACAATGGCAAAACTCGCTTACACTGTGGCAAAAGGCGCTCTCTCTGGAGCCGCAAAATAAGGATT ATCAACGGGGACAAATTTTAACCCTGGCAGATGCTGGTCACTATGATACTGCGCTGGTTAAACTTAAGCAGCTTAACTCT GGAGCACCGGACAAAGCCAATTTACTCGCAGAAGCCTATATCTATAAACTGGCGGGGCGTCATCAGGATGAATTACGGGC GATGACAGAGTCATTACCTGAAAATGCATCTACGCAACAATATCCCACAGAATACGTGCAGGCATTACGTAATAATCAAC TTGCTGCCGCGATTGACGATGCCAATTTAACGCCAGATATTCGCGCTGATATTCATGCCGAACTGGTCAGACTGTCGTTT ATGCCTACGCGCAGTGAAAGTGAACGTTATGCCATTGCCGATCGCGCCCTCGCCCAATACGCTGCATTAGAAATTCTGTG GCACGATAACCCAGACCGTACTGCCCAGTACCAGCGTATTCAGGTTGATCATCTTGGCGCGTTATTAACTCGCGATCGTT ATAAAGACGTTATTTCTCACTATCAGCGATTAAAAAAGACGGGGCAAATTATTCCGCCCTGGGGGCAATATTGGGTTGCA TCGGCTTATCTCAAAGATCATCAGCCGAAAAAAGCACAGTCAATAATGACCGAGCTCTTTTATCACAAGGAGACCATTGC CCCGGATTTATCCGATGAAGAACTTGCGGATCTCTTTTACAGCCACCTGGAGAGTGAAAATTATCCGGGCGCGCTAACTG TCACCCAACATACCATTAATACTTCGCCGCCTTTCCTTCGGTTAATGGGCACGCCTACGAGCATCCCGAATGATACCTGG TTACAGGGGCATTCGTTTCTCTCAACCGTAGCAAAATATAGTAATGATCTTCCTCAGGCTGAAATGACAGCCAGAGAGCT TGCTTATAACGCACCAGGAAATCAGGGACTGCGCATTGATTACGCGAGTGTGTTACAAGCCCGCGGTTGGCCTCGTGCAG CAGAAAATGAATTAAAAAAAGCAGAAGTGATCGAGCCACGTAATATTAATCTGGAGGTTGAACAAGCCTGGACAGCATTA ACGTTACAAGAATGGCAGCAGGCAGCTGTCTTAACGCACGATGTTGTCGAACGTGAACCGCAAGATCCCGGCGTTGTACG ATTAAAACGTGCGGTTGATGTACATAATCTTGCAGAGCTTCGTATCGCTGGCTCAACAGGAATTGATGCCGAAGGCCCGG ATAGTGGTAAACATGATGTCGACTTAACCACCATCGTTTATTCACCACCGCTGAAGGATAACTGGCGCGGTTTTGCTGGA TTCGGTTATGCCGATGGACAATTTAGCGAAGGAAAAGGGATTGTTCGCGACTGGCTTGCGGGTGTTGAGTGGCGGTCACG TAATATCTGGCTCGAGGCAGAGTACGCTGAACGCGTTTTCAATCATGAGCATAAACCCGGCGCGCGCCTGTCTGGCTGGT ATGATTTTAATGATAACTGGCGTATTGGTTCGCAACTGGAACGCCTCTCTCACCGCGTTCCATTACGGGCAATGAAAAAT GGTGTTACAGGCAACAGTGCTCAGGCTTATGTTCGCTGGTATCAAAATGAGCGGCGTAAGTACGGTGTCTCCTGGGCTTT CACTGATTTTTCCGACAGTAACCAGCGTCATGAAGTCTCACTTGAGGGTCAGGAACGCATCTGGTCTTCACCATATTTGA TTGTCGATTTCCTACCCAGTCTGTATTACGAACAAAATACAGAACACGATACCCCATACTACAACCCTATAAAAACGTTC GATATTGTTCCGGCATTTGAGGCAAGCCATTTGTTATGGCGAAGCTATGAAAATAGCTGGGAGCAAATATTCAGCGCAGG TGTTGGTGCCTCCTGGCAAAAACATTATGGCACGGATGTCGTCACCCAACTCGGCTACGGGCAACGCATTAGCTGGAATG ACGTGATTGATGCTGGCGCAACGCTACGCTGGGAAAAACGACCTTATGACGGTGACAGAGAACACAACTTATACGTTGAA TTCGATATGACATTCAGATTTTAA
Upstream 100 bases:
>100_bases GCGTTTAATAACGGATTATGAGGTGCAAAAATATCTTTCTTTTCAGTTACCTGTAATTAGATACAGAGAGAGATTTTGGC AATACATGGAGTAATACAGG
Downstream 100 bases:
>100_bases GGATAAATATGTTACGTAATGGAAATAAATATCTCCTGATGCTGGTGAGTATAATTATGCTCACCGCGTGCATTAGCCAG TCAAGAACATCATTTATACC
Product: outer membrane protein PgaA
Products: NA
Alternate protein names: PGA export protein; Poly-beta-1,6-GlcNAc export protein
Number of amino acids: Translated: 807; Mature: 807
Protein sequence:
>807_residues MYSSSRKRCPKTKWALKLLTAAFLAASPAAKSAVNNAYDALIIEARKGNTQPALSWFALKSALSNNQIADWLQIALWAGQ DKQVITVYNRYRHQQLPARGYAAVAVAYRNLQQWQNSLTLWQKALSLEPQNKDYQRGQILTLADAGHYDTALVKLKQLNS GAPDKANLLAEAYIYKLAGRHQDELRAMTESLPENASTQQYPTEYVQALRNNQLAAAIDDANLTPDIRADIHAELVRLSF MPTRSESERYAIADRALAQYAALEILWHDNPDRTAQYQRIQVDHLGALLTRDRYKDVISHYQRLKKTGQIIPPWGQYWVA SAYLKDHQPKKAQSIMTELFYHKETIAPDLSDEELADLFYSHLESENYPGALTVTQHTINTSPPFLRLMGTPTSIPNDTW LQGHSFLSTVAKYSNDLPQAEMTARELAYNAPGNQGLRIDYASVLQARGWPRAAENELKKAEVIEPRNINLEVEQAWTAL TLQEWQQAAVLTHDVVEREPQDPGVVRLKRAVDVHNLAELRIAGSTGIDAEGPDSGKHDVDLTTIVYSPPLKDNWRGFAG FGYADGQFSEGKGIVRDWLAGVEWRSRNIWLEAEYAERVFNHEHKPGARLSGWYDFNDNWRIGSQLERLSHRVPLRAMKN GVTGNSAQAYVRWYQNERRKYGVSWAFTDFSDSNQRHEVSLEGQERIWSSPYLIVDFLPSLYYEQNTEHDTPYYNPIKTF DIVPAFEASHLLWRSYENSWEQIFSAGVGASWQKHYGTDVVTQLGYGQRISWNDVIDAGATLRWEKRPYDGDREHNLYVE FDMTFRF
Sequences:
>Translated_807_residues MYSSSRKRCPKTKWALKLLTAAFLAASPAAKSAVNNAYDALIIEARKGNTQPALSWFALKSALSNNQIADWLQIALWAGQ DKQVITVYNRYRHQQLPARGYAAVAVAYRNLQQWQNSLTLWQKALSLEPQNKDYQRGQILTLADAGHYDTALVKLKQLNS GAPDKANLLAEAYIYKLAGRHQDELRAMTESLPENASTQQYPTEYVQALRNNQLAAAIDDANLTPDIRADIHAELVRLSF MPTRSESERYAIADRALAQYAALEILWHDNPDRTAQYQRIQVDHLGALLTRDRYKDVISHYQRLKKTGQIIPPWGQYWVA SAYLKDHQPKKAQSIMTELFYHKETIAPDLSDEELADLFYSHLESENYPGALTVTQHTINTSPPFLRLMGTPTSIPNDTW LQGHSFLSTVAKYSNDLPQAEMTARELAYNAPGNQGLRIDYASVLQARGWPRAAENELKKAEVIEPRNINLEVEQAWTAL TLQEWQQAAVLTHDVVEREPQDPGVVRLKRAVDVHNLAELRIAGSTGIDAEGPDSGKHDVDLTTIVYSPPLKDNWRGFAG FGYADGQFSEGKGIVRDWLAGVEWRSRNIWLEAEYAERVFNHEHKPGARLSGWYDFNDNWRIGSQLERLSHRVPLRAMKN GVTGNSAQAYVRWYQNERRKYGVSWAFTDFSDSNQRHEVSLEGQERIWSSPYLIVDFLPSLYYEQNTEHDTPYYNPIKTF DIVPAFEASHLLWRSYENSWEQIFSAGVGASWQKHYGTDVVTQLGYGQRISWNDVIDAGATLRWEKRPYDGDREHNLYVE FDMTFRF >Mature_807_residues MYSSSRKRCPKTKWALKLLTAAFLAASPAAKSAVNNAYDALIIEARKGNTQPALSWFALKSALSNNQIADWLQIALWAGQ DKQVITVYNRYRHQQLPARGYAAVAVAYRNLQQWQNSLTLWQKALSLEPQNKDYQRGQILTLADAGHYDTALVKLKQLNS GAPDKANLLAEAYIYKLAGRHQDELRAMTESLPENASTQQYPTEYVQALRNNQLAAAIDDANLTPDIRADIHAELVRLSF MPTRSESERYAIADRALAQYAALEILWHDNPDRTAQYQRIQVDHLGALLTRDRYKDVISHYQRLKKTGQIIPPWGQYWVA SAYLKDHQPKKAQSIMTELFYHKETIAPDLSDEELADLFYSHLESENYPGALTVTQHTINTSPPFLRLMGTPTSIPNDTW LQGHSFLSTVAKYSNDLPQAEMTARELAYNAPGNQGLRIDYASVLQARGWPRAAENELKKAEVIEPRNINLEVEQAWTAL TLQEWQQAAVLTHDVVEREPQDPGVVRLKRAVDVHNLAELRIAGSTGIDAEGPDSGKHDVDLTTIVYSPPLKDNWRGFAG FGYADGQFSEGKGIVRDWLAGVEWRSRNIWLEAEYAERVFNHEHKPGARLSGWYDFNDNWRIGSQLERLSHRVPLRAMKN GVTGNSAQAYVRWYQNERRKYGVSWAFTDFSDSNQRHEVSLEGQERIWSSPYLIVDFLPSLYYEQNTEHDTPYYNPIKTF DIVPAFEASHLLWRSYENSWEQIFSAGVGASWQKHYGTDVVTQLGYGQRISWNDVIDAGATLRWEKRPYDGDREHNLYVE FDMTFRF
Specific function: Exports the biofilm adhesin polysaccharide poly-beta- 1,6-N-acetyl-D-glucosamine (PGA) across the outer membrane. The PGA transported seems to be partially N-deacetylated since N- deacetylation of PGA by PgaB is needed for PGA export through the PgaA pori
COG id: NA
COG function: NA
Gene ontology:
Cell location: Cell outer membrane; Multi-pass membrane protein
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 3 TPR repeats
Homologues:
Organism=Escherichia coli, GI1787261, Length=807, Percent_Identity=100, Blast_Score=1665, Evalue=0.0,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): PGAA_ECO57 (P69435)
Other databases:
- EMBL: AE005174 - EMBL: BA000007 - PIR: F90787 - RefSeq: NP_287031.1 - RefSeq: NP_309297.1 - ProteinModelPortal: P69435 - EnsemblBacteria: EBESCT00000025152 - EnsemblBacteria: EBESCT00000059956 - GeneID: 912850 - GeneID: 959162 - GenomeReviews: AE005174_GR - GenomeReviews: BA000007_GR - KEGG: ece:Z1526 - KEGG: ecs:ECs1270 - GeneTree: EBGT00050000011311 - HOGENOM: HBG466902 - OMA: LWRHYER - ProtClustDB: PRK10049 - BioCyc: ECOL83334:ECS1270-MONOMER - GO: GO:0005488 - GO: GO:0006810 - InterPro: IPR013026 - InterPro: IPR011990 - InterPro: IPR019734 - Gene3D: G3DSA:1.25.40.10
Pfam domain/function: NA
EC number: NA
Molecular weight: Translated: 92208; Mature: 92208
Theoretical pI: Translated: 6.56; Mature: 6.56
Prosite motif: PS50005 TPR; PS50293 TPR_REGION
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.1 %Cys (Translated Protein) 1.0 %Met (Translated Protein) 1.1 %Cys+Met (Translated Protein) 0.1 %Cys (Mature Protein) 1.0 %Met (Mature Protein) 1.1 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MYSSSRKRCPKTKWALKLLTAAFLAASPAAKSAVNNAYDALIIEARKGNTQPALSWFALK CCCCCCCCCCCHHHHHHHHHHHHHHCCCHHHHHHHCCCEEEEEEECCCCCCHHHHHHHHH SALSNNQIADWLQIALWAGQDKQVITVYNRYRHQQLPARGYAAVAVAYRNLQQWQNSLTL HHHCCCHHHHHHHHHHCCCCCCCEEEHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHH WQKALSLEPQNKDYQRGQILTLADAGHYDTALVKLKQLNSGAPDKANLLAEAYIYKLAGR HHHHHCCCCCCCCCCCCCEEEEECCCCCHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHCC HQDELRAMTESLPENASTQQYPTEYVQALRNNQLAAAIDDANLTPDIRADIHAELVRLSF CHHHHHHHHHHCCCCCCCCCCCHHHHHHHHCCCEEEEECCCCCCCCHHHHHHHHHHHHEE MPTRSESERYAIADRALAQYAALEILWHDNPDRTAQYQRIQVDHLGALLTRDRYKDVISH CCCCCCCCHHHHHHHHHHHHHHEEEEECCCCCCCCHHHEEEHHHHHHHHHHHHHHHHHHH YQRLKKTGQIIPPWGQYWVASAYLKDHQPKKAQSIMTELFYHKETIAPDLSDEELADLFY HHHHHHCCCCCCCCHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHH SHLESENYPGALTVTQHTINTSPPFLRLMGTPTSIPNDTWLQGHSFLSTVAKYSNDLPQA HHHCCCCCCCEEEEEEEECCCCCCEEEEECCCCCCCCCCCHHHHHHHHHHHHHCCCCCHH EMTARELAYNAPGNQGLRIDYASVLQARGWPRAAENELKKAEVIEPRNINLEVEQAWTAL HHHHHHHHCCCCCCCCCEEEHHHHHHHCCCCCHHHHHHHHHHCCCCCCCCEEHHHHHHHH TLQEWQQAAVLTHDVVEREPQDPGVVRLKRAVDVHNLAELRIAGSTGIDAEGPDSGKHDV HHHHHHHHHHHHHHHHHCCCCCCCCEEHHHHHCHHHHEEEEEECCCCCCCCCCCCCCCCE DLTTIVYSPPLKDNWRGFAGFGYADGQFSEGKGIVRDWLAGVEWRSRNIWLEAEYAERVF EEEEEEECCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHCCCEEECCEEEEEEHHHHHHH NHEHKPGARLSGWYDFNDNWRIGSQLERLSHRVPLRAMKNGVTGNSAQAYVRWYQNERRK CCCCCCCCCCCCEEECCCCCCHHHHHHHHHHCCCHHHHHCCCCCCCHHHHHHHHHHHHHH YGVSWAFTDFSDSNQRHEVSLEGQERIWSSPYLIVDFLPSLYYEQNTEHDTPYYNPIKTF CCCEEEEECCCCCCCCEEEEECHHHHHCCCCEEHHHHHHHHHHCCCCCCCCCCCCCCCCE DIVPAFEASHLLWRSYENSWEQIFSAGVGASWQKHYGTDVVTQLGYGQRISWNDVIDAGA ECCCCCCHHHHHHHHHHHHHHHHHHHCCCCCHHHHCCCHHHHHCCCCCCCCHHHHHCCCC TLRWEKRPYDGDREHNLYVEFDMTFRF EEEECCCCCCCCCCCEEEEEEEEEECC >Mature Secondary Structure MYSSSRKRCPKTKWALKLLTAAFLAASPAAKSAVNNAYDALIIEARKGNTQPALSWFALK CCCCCCCCCCCHHHHHHHHHHHHHHCCCHHHHHHHCCCEEEEEEECCCCCCHHHHHHHHH SALSNNQIADWLQIALWAGQDKQVITVYNRYRHQQLPARGYAAVAVAYRNLQQWQNSLTL HHHCCCHHHHHHHHHHCCCCCCCEEEHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHH WQKALSLEPQNKDYQRGQILTLADAGHYDTALVKLKQLNSGAPDKANLLAEAYIYKLAGR HHHHHCCCCCCCCCCCCCEEEEECCCCCHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHCC HQDELRAMTESLPENASTQQYPTEYVQALRNNQLAAAIDDANLTPDIRADIHAELVRLSF CHHHHHHHHHHCCCCCCCCCCCHHHHHHHHCCCEEEEECCCCCCCCHHHHHHHHHHHHEE MPTRSESERYAIADRALAQYAALEILWHDNPDRTAQYQRIQVDHLGALLTRDRYKDVISH CCCCCCCCHHHHHHHHHHHHHHEEEEECCCCCCCCHHHEEEHHHHHHHHHHHHHHHHHHH YQRLKKTGQIIPPWGQYWVASAYLKDHQPKKAQSIMTELFYHKETIAPDLSDEELADLFY HHHHHHCCCCCCCCHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHH SHLESENYPGALTVTQHTINTSPPFLRLMGTPTSIPNDTWLQGHSFLSTVAKYSNDLPQA HHHCCCCCCCEEEEEEEECCCCCCEEEEECCCCCCCCCCCHHHHHHHHHHHHHCCCCCHH EMTARELAYNAPGNQGLRIDYASVLQARGWPRAAENELKKAEVIEPRNINLEVEQAWTAL HHHHHHHHCCCCCCCCCEEEHHHHHHHCCCCCHHHHHHHHHHCCCCCCCCEEHHHHHHHH TLQEWQQAAVLTHDVVEREPQDPGVVRLKRAVDVHNLAELRIAGSTGIDAEGPDSGKHDV HHHHHHHHHHHHHHHHHCCCCCCCCEEHHHHHCHHHHEEEEEECCCCCCCCCCCCCCCCE DLTTIVYSPPLKDNWRGFAGFGYADGQFSEGKGIVRDWLAGVEWRSRNIWLEAEYAERVF EEEEEEECCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHCCCEEECCEEEEEEHHHHHHH NHEHKPGARLSGWYDFNDNWRIGSQLERLSHRVPLRAMKNGVTGNSAQAYVRWYQNERRK CCCCCCCCCCCCEEECCCCCCHHHHHHHHHHCCCHHHHHCCCCCCCHHHHHHHHHHHHHH YGVSWAFTDFSDSNQRHEVSLEGQERIWSSPYLIVDFLPSLYYEQNTEHDTPYYNPIKTF CCCEEEEECCCCCCCCEEEEECHHHHHCCCCEEHHHHHHHHHHCCCCCCCCCCCCCCCCE DIVPAFEASHLLWRSYENSWEQIFSAGVGASWQKHYGTDVVTQLGYGQRISWNDVIDAGA ECCCCCCHHHHHHHHHHHHHHHHHHHCCCCCHHHHCCCHHHHHCCCCCCCCHHHHHCCCC TLRWEKRPYDGDREHNLYVEFDMTFRF EEEECCCCCCCCCCCEEEEEEEEEECC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 6.0
TargetDB status: NA
Availability: NA
References: 11206551; 11258796