| Definition | Escherichia coli O157:H7 str. EC4115, complete genome. |
|---|---|
| Accession | NC_011353 |
| Length | 5,572,075 |
Click here to switch to the map view.
The map label for this gene is atoS [C]
Identifier: 209400726
GI number: 209400726
Start: 5241654
End: 5243924
Strand: Direct
Name: atoS [C]
Synonym: ECH74115_5603
Alternate gene names: 209400726
Gene position: 5241654-5243924 (Clockwise)
Preceding gene: 209396346
Following gene: 209398344
Centisome position: 94.07
GC content: 57.51
Gene sequence:
>2271_bases ATGGCGCACCCCGGACGTCACTTTTTTGCCAGCGCGCGCGGGCGATTGCTGCTTTTGAATTTGCTGGTGGTGGCGGTGAC GTTGATGGTCAGCGGCGTGGCGGTAATGGGCTTTCGTCATGCCAGCCAGATGCAGGAGCTGGTGCAGCAGCAAACGGTGG ATGATATGACCGGCAGCCTGAATCTGGCGCGCGACACGGCAAACGTGGCAACGGCGGCGGTGCGATTGTCGCAGGTGGTG GGAGCGCTGGAATATAAAGGCGAAGCCGAGCGGTTGCAGGAGACACAGCGGGCATTAAAAAGCTCGCTTGCACAACTGGC GAACGCGCCTTTAGCGCAGCAGGAAGCCGGGCTGGTGACGCGAATCATCACGCGTAGCAACGAACTGCAAACCAGCGTCG GCGGTATGCTGGAGCGCGGGCAAAGGCGGCATCTGGAGCGCAACGCGCTGTTAAGTTCGCTGTATCAAAACTTAAGTTAT CTGCGGCATCTGCAAAAAGTCACTCACGCGCAAGATGATATTTTGCTTAACGAGATGAACCGACTGATTGTTGCCGCTAT TGCCACCCCCGCGCCGCAGGCGATTATTCATCAACTGGTCGGGGTAATGTCTGCGTTGCCGACCCACAGCGATACGCCAT TGGTTAATACGTTACTCAATGATTTCAATGATTTCAATGATGAAATGCGTAAACTCGCGCCGCTTTCTGCCGCTCTGGAG CAAAGCGATCTGGCAATCAGCTGGTATATGTTTCACATCAAAGCGCTGGTGGCGATCCTCAATGGCGACATCAACCGTTA CGCCGAACAGGTGGCGACGCTCTCCGGTCAGCGTGTGGCGCAAAGTTACCAGGATTTGCGCTCCGGCGAGAGGGTGATCA TGATTTTCGCCCTGTTAGCGGTGGTGATCACCGCGTTTGCCGGCTGGTATATCTATCGCAACCTCGGCACTAACCTGACG GCGATTTCCCGCGCCATGAGCCGCCTGGCGCACGGCGAAGCGGACGTCACTTTTCCGGCGTTACAGCGGCGTGATGAGTT GGGTGAACTGGCGCGCGCCTTTAACGTTTTTGCCCGCAATACCGCGTCACTCGAACGAACCTCACGGCTGCTAAAAGAGA AGACCACGCAGATGGAGATTGCCCAAACTGAGCGGCAGGGGTTGGAAGAGGCGCTATTACACAGCCAGAAACTGAAAGCT GTCGGGCAACTGACGGGCGGGCTGGCCCATGATTTTAATAATCTGCTGGCGGTGATTATTGGCAGCCTGGAGCTGGTGAA TCCGGACTCGCCAGACGCGCCGCGAATACAGCGGGCGCTGCAAGCTGCCGAACGTGGGGCGCTACTGACACAACGACTGC TGGCGTTTTCCCGCAAGCAGTCCTTACATCCGCAAGCCGTTGAACTGAAAACATTGCTGGAAGAGTTAAGCGAATTAATG CGCCACTCCTTACCGGCAACGCTGGCGCTGGAGATTGAAGCGCAGTCTCCGGCGTGGCCCGCGTGGATTGACATCAGCCA ACTGGAAAATGCCATCATCAACCTGGTGATGAACGCCCGTGACGCGATGGAAGGGCAGACGGGAATCATCAAAATTCGTA CCTGGAATCAGCGCGTTACTCGCAGCAGTGGGCAGCGTCAGGACATGGTGGCACTGGAGGTCATCGATCATGGCTGCGGT ATGTCGCAGGCGGTGAAAAGCCAGGTATTTGAGCCATTCTTTACCACCAAACAGACGGGCAGCGGCAGCGGGCTGGGTTT GTCGATGGTCTATGGTTTTGTGCGCCAGTCCGGTGGGCGCGTTGAAATTGAAAGCGCGCCGGGGCAGGGGACAACGGTCA GATTACAGCTTCCCCGCGCGCTGACGGCGGCGAAAAACCTATCGCCAGCGGCAGTAGAACAGGCTTCTGTCAGCGGCGAT AAACTGGTGTTAGTGCTGGAAGATGAAGCCGCGGTGCGCCAGACCATCTGCGAACAGTTGCACCTGCTGGGCTATTTGAC GCTGGAAGCAAGCAGCGGCGAACAGGCGCTGGATCTGCTGGCGGCATCAGCAGAAATCGATATTTTTATCAGCGATTTAA TGCTCCCCGGCGGCATGAGCGGCGCAGAAGTGGTCAATGCGGCCCGCAAACTTTACCCGCACCTGACGCTGCTACTCATC AGCGGTCAGGATTTACGCCCCAGCCATAACCCCGCGCTGCCAGACGTGGCGCTGTTGCGCAAACCCTTTACCCGTGCGCA GTTGGCGCAGGCGCTGGGGCAAGAGAATTGA
Upstream 100 bases:
>100_bases GAGGTTGTCGATATCAGCACTCCATCACAGGAAAGTAAATGCAAAATGTCAGAAGCCGTTCATATTTGTCATATTGCGAT TTTTCTTCACGGAGCGTGAT
Downstream 100 bases:
>100_bases GAATCCTCCTCTACTCGTAACAGGCACCTTTGCCTACCTTGTATTAACTTTGTTGCGAGGCCGAGTTTATGAAACGCCAC TCCACGCTTTTTCTTTTCAC
Product: hypothetical protein
Products: NA
Alternate protein names: Blue-light-activated histidine kinase; Response regulator [H]
Number of amino acids: Translated: 756; Mature: 755
Protein sequence:
>756_residues MAHPGRHFFASARGRLLLLNLLVVAVTLMVSGVAVMGFRHASQMQELVQQQTVDDMTGSLNLARDTANVATAAVRLSQVV GALEYKGEAERLQETQRALKSSLAQLANAPLAQQEAGLVTRIITRSNELQTSVGGMLERGQRRHLERNALLSSLYQNLSY LRHLQKVTHAQDDILLNEMNRLIVAAIATPAPQAIIHQLVGVMSALPTHSDTPLVNTLLNDFNDFNDEMRKLAPLSAALE QSDLAISWYMFHIKALVAILNGDINRYAEQVATLSGQRVAQSYQDLRSGERVIMIFALLAVVITAFAGWYIYRNLGTNLT AISRAMSRLAHGEADVTFPALQRRDELGELARAFNVFARNTASLERTSRLLKEKTTQMEIAQTERQGLEEALLHSQKLKA VGQLTGGLAHDFNNLLAVIIGSLELVNPDSPDAPRIQRALQAAERGALLTQRLLAFSRKQSLHPQAVELKTLLEELSELM RHSLPATLALEIEAQSPAWPAWIDISQLENAIINLVMNARDAMEGQTGIIKIRTWNQRVTRSSGQRQDMVALEVIDHGCG MSQAVKSQVFEPFFTTKQTGSGSGLGLSMVYGFVRQSGGRVEIESAPGQGTTVRLQLPRALTAAKNLSPAAVEQASVSGD KLVLVLEDEAAVRQTICEQLHLLGYLTLEASSGEQALDLLAASAEIDIFISDLMLPGGMSGAEVVNAARKLYPHLTLLLI SGQDLRPSHNPALPDVALLRKPFTRAQLAQALGQEN
Sequences:
>Translated_756_residues MAHPGRHFFASARGRLLLLNLLVVAVTLMVSGVAVMGFRHASQMQELVQQQTVDDMTGSLNLARDTANVATAAVRLSQVV GALEYKGEAERLQETQRALKSSLAQLANAPLAQQEAGLVTRIITRSNELQTSVGGMLERGQRRHLERNALLSSLYQNLSY LRHLQKVTHAQDDILLNEMNRLIVAAIATPAPQAIIHQLVGVMSALPTHSDTPLVNTLLNDFNDFNDEMRKLAPLSAALE QSDLAISWYMFHIKALVAILNGDINRYAEQVATLSGQRVAQSYQDLRSGERVIMIFALLAVVITAFAGWYIYRNLGTNLT AISRAMSRLAHGEADVTFPALQRRDELGELARAFNVFARNTASLERTSRLLKEKTTQMEIAQTERQGLEEALLHSQKLKA VGQLTGGLAHDFNNLLAVIIGSLELVNPDSPDAPRIQRALQAAERGALLTQRLLAFSRKQSLHPQAVELKTLLEELSELM RHSLPATLALEIEAQSPAWPAWIDISQLENAIINLVMNARDAMEGQTGIIKIRTWNQRVTRSSGQRQDMVALEVIDHGCG MSQAVKSQVFEPFFTTKQTGSGSGLGLSMVYGFVRQSGGRVEIESAPGQGTTVRLQLPRALTAAKNLSPAAVEQASVSGD KLVLVLEDEAAVRQTICEQLHLLGYLTLEASSGEQALDLLAASAEIDIFISDLMLPGGMSGAEVVNAARKLYPHLTLLLI SGQDLRPSHNPALPDVALLRKPFTRAQLAQALGQEN >Mature_755_residues AHPGRHFFASARGRLLLLNLLVVAVTLMVSGVAVMGFRHASQMQELVQQQTVDDMTGSLNLARDTANVATAAVRLSQVVG ALEYKGEAERLQETQRALKSSLAQLANAPLAQQEAGLVTRIITRSNELQTSVGGMLERGQRRHLERNALLSSLYQNLSYL RHLQKVTHAQDDILLNEMNRLIVAAIATPAPQAIIHQLVGVMSALPTHSDTPLVNTLLNDFNDFNDEMRKLAPLSAALEQ SDLAISWYMFHIKALVAILNGDINRYAEQVATLSGQRVAQSYQDLRSGERVIMIFALLAVVITAFAGWYIYRNLGTNLTA ISRAMSRLAHGEADVTFPALQRRDELGELARAFNVFARNTASLERTSRLLKEKTTQMEIAQTERQGLEEALLHSQKLKAV GQLTGGLAHDFNNLLAVIIGSLELVNPDSPDAPRIQRALQAAERGALLTQRLLAFSRKQSLHPQAVELKTLLEELSELMR HSLPATLALEIEAQSPAWPAWIDISQLENAIINLVMNARDAMEGQTGIIKIRTWNQRVTRSSGQRQDMVALEVIDHGCGM SQAVKSQVFEPFFTTKQTGSGSGLGLSMVYGFVRQSGGRVEIESAPGQGTTVRLQLPRALTAAKNLSPAAVEQASVSGDK LVLVLEDEAAVRQTICEQLHLLGYLTLEASSGEQALDLLAASAEIDIFISDLMLPGGMSGAEVVNAARKLYPHLTLLLIS GQDLRPSHNPALPDVALLRKPFTRAQLAQALGQEN
Specific function: Photosensitive kinase and response regulator that is involved in increased bacterial virulence upon exposure to light [H]
COG id: NA
COG function: NA
Gene ontology:
Cell location: Integral Membrane Protein. Inner Membrane [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 1 response regulatory domain [H]
Homologues:
Organism=Escherichia coli, GI1788549, Length=316, Percent_Identity=29.1139240506329, Blast_Score=107, Evalue=3e-24, Organism=Escherichia coli, GI87081816, Length=454, Percent_Identity=25.9911894273128, Blast_Score=92, Evalue=2e-19, Organism=Escherichia coli, GI1790436, Length=243, Percent_Identity=29.2181069958848, Blast_Score=88, Evalue=2e-18, Organism=Escherichia coli, GI1788713, Length=335, Percent_Identity=26.5671641791045, Blast_Score=77, Evalue=5e-15, Organism=Escherichia coli, GI1790300, Length=247, Percent_Identity=27.5303643724696, Blast_Score=74, Evalue=5e-14,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR003594 - InterPro: IPR011006 - InterPro: IPR001610 - InterPro: IPR000014 - InterPro: IPR000700 - InterPro: IPR013767 - InterPro: IPR004358 - InterPro: IPR003661 - InterPro: IPR005467 - InterPro: IPR009082 - InterPro: IPR001789 [H]
Pfam domain/function: PF02518 HATPase_c; PF00512 HisKA; PF00989 PAS; PF00072 Response_reg [H]
EC number: =2.7.13.3 [H]
Molecular weight: Translated: 82520; Mature: 82389
Theoretical pI: Translated: 6.92; Mature: 6.92
Prosite motif: PS50885 HAMP ; PS50110 RESPONSE_REGULATORY ; PS50109 HIS_KIN
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.3 %Cys (Translated Protein) 2.8 %Met (Translated Protein) 3.0 %Cys+Met (Translated Protein) 0.3 %Cys (Mature Protein) 2.6 %Met (Mature Protein) 2.9 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MAHPGRHFFASARGRLLLLNLLVVAVTLMVSGVAVMGFRHASQMQELVQQQTVDDMTGSL CCCCCCHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCC NLARDTANVATAAVRLSQVVGALEYKGEAERLQETQRALKSSLAQLANAPLAQQEAGLVT EEHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHH RIITRSNELQTSVGGMLERGQRRHLERNALLSSLYQNLSYLRHLQKVTHAQDDILLNEMN HHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH RLIVAAIATPAPQAIIHQLVGVMSALPTHSDTPLVNTLLNDFNDFNDEMRKLAPLSAALE HHHHHHHCCCCHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHH QSDLAISWYMFHIKALVAILNGDINRYAEQVATLSGQRVAQSYQDLRSGERVIMIFALLA HCCCHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHH VVITAFAGWYIYRNLGTNLTAISRAMSRLAHGEADVTFPALQRRDELGELARAFNVFARN HHHHHHHHHHHHHHCCCCHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHHCC TASLERTSRLLKEKTTQMEIAQTERQGLEEALLHSQKLKAVGQLTGGLAHDFNNLLAVII HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH GSLELVNPDSPDAPRIQRALQAAERGALLTQRLLAFSRKQSLHPQAVELKTLLEELSELM CCHHEECCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHH RHSLPATLALEIEAQSPAWPAWIDISQLENAIINLVMNARDAMEGQTGIIKIRTWNQRVT HHCCCCEEEEEEECCCCCCCCEEEHHHHHHHHHHHHHHHHHHCCCCCCEEEEEECCHHHH RSSGQRQDMVALEVIDHGCGMSQAVKSQVFEPFFTTKQTGSGSGLGLSMVYGFVRQSGGR HCCCCHHHHHHHHHHHCCCCHHHHHHHHHHCHHHCCCCCCCCCCCHHHHHHHHHHCCCCE VEIESAPGQGTTVRLQLPRALTAAKNLSPAAVEQASVSGDKLVLVLEDEAAVRQTICEQL EEEECCCCCCCEEEEECCHHHHHHCCCCHHHHHHHCCCCCEEEEEECCHHHHHHHHHHHH HLLGYLTLEASSGEQALDLLAASAEIDIFISDLMLPGGMSGAEVVNAARKLYPHLTLLLI HHHHEEEEECCCCHHHHHHHHHCCHHHHHHHHHHCCCCCCHHHHHHHHHHHHCHHEEEEE SGQDLRPSHNPALPDVALLRKPFTRAQLAQALGQEN ECCCCCCCCCCCCCCHHHHHCCCHHHHHHHHHCCCC >Mature Secondary Structure AHPGRHFFASARGRLLLLNLLVVAVTLMVSGVAVMGFRHASQMQELVQQQTVDDMTGSL CCCCCHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCC NLARDTANVATAAVRLSQVVGALEYKGEAERLQETQRALKSSLAQLANAPLAQQEAGLVT EEHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHH RIITRSNELQTSVGGMLERGQRRHLERNALLSSLYQNLSYLRHLQKVTHAQDDILLNEMN HHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH RLIVAAIATPAPQAIIHQLVGVMSALPTHSDTPLVNTLLNDFNDFNDEMRKLAPLSAALE HHHHHHHCCCCHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHH QSDLAISWYMFHIKALVAILNGDINRYAEQVATLSGQRVAQSYQDLRSGERVIMIFALLA HCCCHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHH VVITAFAGWYIYRNLGTNLTAISRAMSRLAHGEADVTFPALQRRDELGELARAFNVFARN HHHHHHHHHHHHHHCCCCHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHHCC TASLERTSRLLKEKTTQMEIAQTERQGLEEALLHSQKLKAVGQLTGGLAHDFNNLLAVII HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH GSLELVNPDSPDAPRIQRALQAAERGALLTQRLLAFSRKQSLHPQAVELKTLLEELSELM CCHHEECCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHH RHSLPATLALEIEAQSPAWPAWIDISQLENAIINLVMNARDAMEGQTGIIKIRTWNQRVT HHCCCCEEEEEEECCCCCCCCEEEHHHHHHHHHHHHHHHHHHCCCCCCEEEEEECCHHHH RSSGQRQDMVALEVIDHGCGMSQAVKSQVFEPFFTTKQTGSGSGLGLSMVYGFVRQSGGR HCCCCHHHHHHHHHHHCCCCHHHHHHHHHHCHHHCCCCCCCCCCCHHHHHHHHHHCCCCE VEIESAPGQGTTVRLQLPRALTAAKNLSPAAVEQASVSGDKLVLVLEDEAAVRQTICEQL EEEECCCCCCCEEEEECCHHHHHHCCCCHHHHHHHCCCCCEEEEEECCHHHHHHHHHHHH HLLGYLTLEASSGEQALDLLAASAEIDIFISDLMLPGGMSGAEVVNAARKLYPHLTLLLI HHHHEEEEECCCCHHHHHHHHHCCHHHHHHHHHHCCCCCCHHHHHHHHHHHHCHHEEEEE SGQDLRPSHNPALPDVALLRKPFTRAQLAQALGQEN ECCCCCCCCCCCCCCHHHHHCCCHHHHHHHHHCCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 6.0
TargetDB status: NA
Availability: NA
References: NA