| Definition | Escherichia coli O157:H7 str. EC4115, complete genome. |
|---|---|
| Accession | NC_011353 |
| Length | 5,572,075 |
Click here to switch to the map view.
The map label for this gene is sapA [H]
Identifier: 209399749
GI number: 209399749
Start: 1830415
End: 1832034
Strand: Reverse
Name: sapA [H]
Synonym: ECH74115_1935
Alternate gene names: 209399749
Gene position: 1832034-1830415 (Counterclockwise)
Preceding gene: 209396371
Following gene: 209400983
Centisome position: 32.88
GC content: 54.38
Gene sequence:
>1620_bases TTGGTGATTGCTGGACTTGTGAGTGGTCAGGCAATCGCCGCGCCTGAATCCCCCCCGCATGCTGATATCCGCGACAGCGG TTTTGTCTATTGCGTCAGCGGGCAAGTCAACACCTTTAACCCATCCAAAGCGAGCAGTGGGTTAATTGTCGATACCCTTG CCGCCCAGTTTTATGATCGACTGCTGGATGTCGATCCCTATACCTATCGCCTGATGCCAGAACTTGCCGAAAGCTGGGAA GTACTCGACAACGGCGCGACCTATCGCTTCCACCTGCGTCGCGATGTCCCGTTTCAAAAAACCGCCTGGTTTACTCCCAC TCGCAAAATGAATGCCGACGATGTGGTGTTTACCTTCCAGCGAATTTTTGACCGCAACAACCCGTGGCATAACGTCAACG GCAGCAACTTCCCCTACTTCGACAGCCTGCAATTTGCCGATAACGTGAAAAGCGTCCGTAAACTGGATAATCATACCGTT GAGTTCCGTCTGGCTCAGCCGGATGCTTCTTTTTTGTGGCACCTCGCAACCCATTATGCTTCGGTCATGTCGGCAGAATA TGCCCGGAAGTTAGAGAAAGAAGATCGCCAGGAGCAACTCGACCGTCAACCGGTCGGCACTGGACCGTATCAGTTGTCGG AATACCGCGCCGGGCAATTTATTCGCCTACAACGTCATGATGACTTCTGGCGCGGTAAACCGTTAATGCCGCAGGTGGTG GTGGATTTAGGCTCCGGCGGCACCGGACGTCTGTCGAAACTCCTGACCGGGGAATGCGACGTTCTGGCCTGGCCTGCTGC CAGCCAGCTATCCATTTTGCGTGACGACCCGCGCTTGCGTTTAACGCTGCGTCCTGGGATGAACGTCGCCTATCTGGCAT TTAACACCGCCAAACCGCCGCTAAATAATCCCGCTGTCCGCCATGCGCTGGCACTGGCGATTAATAACCAGCGCCTGATG CAATCCATCTATTATGGTACGGCTGAAACGGCGGCCTCTATTTTACCGCGCGCCTCGTGGGCCTATGACAACGAGGCTAA AATTACTGAATACAATCCGGCGAAATCGCGCGAACAGTTGAAGTTGTTGGGGCTGGAAAATTTAACGCTGAAACTGTGGG TGCCCACACGTTCGCAGGCGTGGAACCCCAGTCCACTGAAAACTGCCGAACTGATTCAGGCGGATATGGCGCAGGTTGGC GTAAAAGTGGTGATTGTGCCGGTAGAAGGTCGCTTTCAGGAGGCGCGGTTGATGGATATGAGCCATGATCTGACGTTATC CGGTTGGGCGACGGACAGTAACGACCCGGACAGTTTCTTCCGTCCGTTACTGAGCTGCGCGGCAATTCATTCACAGACCA ACCTCGCCCACTGGTGCGATCCGAAATTCGACAGCGTGTTGCGTAAGACGCTCTCCTCGCAGCAGCTGGCGGCGCGTATT GAAGCCTATGACGAAGCGCAGAGTATTCTGGCGCAGGAATTGCCCATTTTGCCGCTGGCGTCGTCATTGCGTTTGCAGGC CTATCGGTACGATATCAAAGGTCTGGTACTTAGCCCGTTTGGTAACGCCTCCTTTGCTGGGGTGTATCGCGAGAAACAGG ATGAGGTGAAAAAACCATGA
Upstream 100 bases:
>100_bases CCTGAACACAAACGGTAATGGAAAATGTCATTAAATATTAGTAAGATAGCCTCTTTACATAAAATCCCTTAATATTATGC GCCAGGTATTATCGTCTCTT
Downstream 100 bases:
>100_bases TTATCTTCACCTTACGCCGCATTTTGTTATTGATTGTCACCTTGTTCCTGCTGACCTTCGTTGGCTTCAGCTTGAGCTAT TTCACTCCACACGCGCCGTT
Product: peptide ABC transporter, periplasmic peptide-binding protein
Products: ADP; phosphate; peptides [Cytoplasm] [C]
Alternate protein names: NA
Number of amino acids: Translated: 539; Mature: 539
Protein sequence:
>539_residues MVIAGLVSGQAIAAPESPPHADIRDSGFVYCVSGQVNTFNPSKASSGLIVDTLAAQFYDRLLDVDPYTYRLMPELAESWE VLDNGATYRFHLRRDVPFQKTAWFTPTRKMNADDVVFTFQRIFDRNNPWHNVNGSNFPYFDSLQFADNVKSVRKLDNHTV EFRLAQPDASFLWHLATHYASVMSAEYARKLEKEDRQEQLDRQPVGTGPYQLSEYRAGQFIRLQRHDDFWRGKPLMPQVV VDLGSGGTGRLSKLLTGECDVLAWPAASQLSILRDDPRLRLTLRPGMNVAYLAFNTAKPPLNNPAVRHALALAINNQRLM QSIYYGTAETAASILPRASWAYDNEAKITEYNPAKSREQLKLLGLENLTLKLWVPTRSQAWNPSPLKTAELIQADMAQVG VKVVIVPVEGRFQEARLMDMSHDLTLSGWATDSNDPDSFFRPLLSCAAIHSQTNLAHWCDPKFDSVLRKTLSSQQLAARI EAYDEAQSILAQELPILPLASSLRLQAYRYDIKGLVLSPFGNASFAGVYREKQDEVKKP
Sequences:
>Translated_539_residues MVIAGLVSGQAIAAPESPPHADIRDSGFVYCVSGQVNTFNPSKASSGLIVDTLAAQFYDRLLDVDPYTYRLMPELAESWE VLDNGATYRFHLRRDVPFQKTAWFTPTRKMNADDVVFTFQRIFDRNNPWHNVNGSNFPYFDSLQFADNVKSVRKLDNHTV EFRLAQPDASFLWHLATHYASVMSAEYARKLEKEDRQEQLDRQPVGTGPYQLSEYRAGQFIRLQRHDDFWRGKPLMPQVV VDLGSGGTGRLSKLLTGECDVLAWPAASQLSILRDDPRLRLTLRPGMNVAYLAFNTAKPPLNNPAVRHALALAINNQRLM QSIYYGTAETAASILPRASWAYDNEAKITEYNPAKSREQLKLLGLENLTLKLWVPTRSQAWNPSPLKTAELIQADMAQVG VKVVIVPVEGRFQEARLMDMSHDLTLSGWATDSNDPDSFFRPLLSCAAIHSQTNLAHWCDPKFDSVLRKTLSSQQLAARI EAYDEAQSILAQELPILPLASSLRLQAYRYDIKGLVLSPFGNASFAGVYREKQDEVKKP >Mature_539_residues MVIAGLVSGQAIAAPESPPHADIRDSGFVYCVSGQVNTFNPSKASSGLIVDTLAAQFYDRLLDVDPYTYRLMPELAESWE VLDNGATYRFHLRRDVPFQKTAWFTPTRKMNADDVVFTFQRIFDRNNPWHNVNGSNFPYFDSLQFADNVKSVRKLDNHTV EFRLAQPDASFLWHLATHYASVMSAEYARKLEKEDRQEQLDRQPVGTGPYQLSEYRAGQFIRLQRHDDFWRGKPLMPQVV VDLGSGGTGRLSKLLTGECDVLAWPAASQLSILRDDPRLRLTLRPGMNVAYLAFNTAKPPLNNPAVRHALALAINNQRLM QSIYYGTAETAASILPRASWAYDNEAKITEYNPAKSREQLKLLGLENLTLKLWVPTRSQAWNPSPLKTAELIQADMAQVG VKVVIVPVEGRFQEARLMDMSHDLTLSGWATDSNDPDSFFRPLLSCAAIHSQTNLAHWCDPKFDSVLRKTLSSQQLAARI EAYDEAQSILAQELPILPLASSLRLQAYRYDIKGLVLSPFGNASFAGVYREKQDEVKKP
Specific function: Involved in a peptide intake transport system that plays a role in the resistance to antimicrobial peptides [H]
COG id: COG4166
COG function: function code E; ABC-type oligopeptide transport system, periplasmic component
Gene ontology:
Cell location: Periplasm (Probable) [H]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the bacterial solute-binding protein 5 family [H]
Homologues:
Organism=Escherichia coli, GI1787551, Length=539, Percent_Identity=99.2578849721707, Blast_Score=1108, Evalue=0.0, Organism=Escherichia coli, GI1789966, Length=512, Percent_Identity=35.546875, Blast_Score=372, Evalue=1e-104, Organism=Escherichia coli, GI1787052, Length=510, Percent_Identity=27.4509803921569, Blast_Score=155, Evalue=6e-39, Organism=Escherichia coli, GI1787762, Length=467, Percent_Identity=23.1263383297645, Blast_Score=131, Evalue=1e-31, Organism=Escherichia coli, GI1787495, Length=529, Percent_Identity=24.7637051039698, Blast_Score=107, Evalue=2e-24, Organism=Escherichia coli, GI1789887, Length=496, Percent_Identity=25, Blast_Score=104, Evalue=2e-23, Organism=Escherichia coli, GI1789397, Length=524, Percent_Identity=23.2824427480916, Blast_Score=87, Evalue=4e-18,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR000914 [H]
Pfam domain/function: PF00496 SBP_bac_5 [H]
EC number: NA
Molecular weight: Translated: 60680; Mature: 60680
Theoretical pI: Translated: 7.36; Mature: 7.36
Prosite motif: PS01040 SBP_BACTERIAL_5
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.7 %Cys (Translated Protein) 1.9 %Met (Translated Protein) 2.6 %Cys+Met (Translated Protein) 0.7 %Cys (Mature Protein) 1.9 %Met (Mature Protein) 2.6 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MVIAGLVSGQAIAAPESPPHADIRDSGFVYCVSGQVNTFNPSKASSGLIVDTLAAQFYDR CEEEEEECCCEEECCCCCCCCCCCCCCEEEEECCCCCCCCCCCCCCCCHHHHHHHHHHHH LLDVDPYTYRLMPELAESWEVLDNGATYRFHLRRDVPFQKTAWFTPTRKMNADDVVFTFQ HHCCCCCHHHHHHHHHHHHHHHCCCCEEEEEEECCCCCCCCEEECCCCCCCCCHHHHHHH RIFDRNNPWHNVNGSNFPYFDSLQFADNVKSVRKLDNHTVEFRLAQPDASFLWHLATHYA HHHCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHCCCEEEEEEECCCHHHHHHHHHHHH SVMSAEYARKLEKEDRQEQLDRQPVGTGPYQLSEYRAGQFIRLQRHDDFWRGKPLMPQVV HHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCHHHCCCCCEEEEECCCCCCCCCCCCHHHE VDLGSGGTGRLSKLLTGECDVLAWPAASQLSILRDDPRLRLTLRPGMNVAYLAFNTAKPP EECCCCCCHHHHHHHCCCCCEEECCCCCCHHEEECCCCEEEEECCCCCEEEEEEECCCCC LNNPAVRHALALAINNQRLMQSIYYGTAETAASILPRASWAYDNEAKITEYNPAKSREQL CCCHHHHHHHHHEECCHHHHHHHHCCCHHHHHHHCCCCCCCCCCCCEEEECCCCCCHHHE KLLGLENLTLKLWVPTRSQAWNPSPLKTAELIQADMAQVGVKVVIVPVEGRFQEARLMDM EEECCCCCEEEEEECCCCCCCCCCCCHHHHHHHHHHHHCCEEEEEEECCCCCCHHHHHCC SHDLTLSGWATDSNDPDSFFRPLLSCAAIHSQTNLAHWCDPKFDSVLRKTLSSQQLAARI CCCEEEEECCCCCCCHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHHHHH EAYDEAQSILAQELPILPLASSLRLQAYRYDIKGLVLSPFGNASFAGVYREKQDEVKKP HHHHHHHHHHHHHCCCCCCCHHHEEEEEEEEECEEEECCCCCCCCHHHHHHHHHHCCCC >Mature Secondary Structure MVIAGLVSGQAIAAPESPPHADIRDSGFVYCVSGQVNTFNPSKASSGLIVDTLAAQFYDR CEEEEEECCCEEECCCCCCCCCCCCCCEEEEECCCCCCCCCCCCCCCCHHHHHHHHHHHH LLDVDPYTYRLMPELAESWEVLDNGATYRFHLRRDVPFQKTAWFTPTRKMNADDVVFTFQ HHCCCCCHHHHHHHHHHHHHHHCCCCEEEEEEECCCCCCCCEEECCCCCCCCCHHHHHHH RIFDRNNPWHNVNGSNFPYFDSLQFADNVKSVRKLDNHTVEFRLAQPDASFLWHLATHYA HHHCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHCCCEEEEEEECCCHHHHHHHHHHHH SVMSAEYARKLEKEDRQEQLDRQPVGTGPYQLSEYRAGQFIRLQRHDDFWRGKPLMPQVV HHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCHHHCCCCCEEEEECCCCCCCCCCCCHHHE VDLGSGGTGRLSKLLTGECDVLAWPAASQLSILRDDPRLRLTLRPGMNVAYLAFNTAKPP EECCCCCCHHHHHHHCCCCCEEECCCCCCHHEEECCCCEEEEECCCCCEEEEEEECCCCC LNNPAVRHALALAINNQRLMQSIYYGTAETAASILPRASWAYDNEAKITEYNPAKSREQL CCCHHHHHHHHHEECCHHHHHHHHCCCHHHHHHHCCCCCCCCCCCCEEEECCCCCCHHHE KLLGLENLTLKLWVPTRSQAWNPSPLKTAELIQADMAQVGVKVVIVPVEGRFQEARLMDM EEECCCCCEEEEEECCCCCCCCCCCCHHHHHHHHHHHHCCEEEEEEECCCCCCHHHHHCC SHDLTLSGWATDSNDPDSFFRPLLSCAAIHSQTNLAHWCDPKFDSVLRKTLSSQQLAARI CCCEEEEECCCCCCCHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHHHHH EAYDEAQSILAQELPILPLASSLRLQAYRYDIKGLVLSPFGNASFAGVYREKQDEVKKP HHHHHHHHHHHHHCCCCCCCHHHEEEEEEEEECEEEECCCCCCCCHHHHHHHHHHCCCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: ATP; peptides [Periplasm]; H2O [C]
Specific reaction: ATP + peptides [Periplasm] + H2O = ADP + phosphate + peptides [Cytoplasm] [C]
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 8223423; 11677609 [H]