| Definition | Escherichia coli O157:H7 str. EC4115, complete genome. |
|---|---|
| Accession | NC_011353 |
| Length | 5,572,075 |
Click here to switch to the map view.
The map label for this gene is stfR [H]
Identifier: 209400441
GI number: 209400441
Start: 1587551
End: 1589101
Strand: Direct
Name: stfR [H]
Synonym: ECH74115_1643
Alternate gene names: 209400441
Gene position: 1587551-1589101 (Clockwise)
Preceding gene: 209399679
Following gene: 209398519
Centisome position: 28.49
GC content: 50.74
Gene sequence:
>1551_bases GTGGCGCTTGAGGATGCGAGCACGACGAAAAAGGGGATAGTACAGCTCAGCAGTGCGACTAACAGCACTTCCGAGTCACT GGCGGCAACGCCAAAAGCCGTTAAGGCCGCGTATGAGCTGGCTAACGGGAAATACACCGCACAGGATGCAACGACAGCAC AGAAAGGGATAGTTCAGCTTAGCAACGCGACCAACAGCACATCTGAAATGCTGGCGGCAACGCCAAAGTCGGTAAAGGCA GCCTATGACCTTGCTAACGGGAAATATACTGCTCAGGACGCTACGACAGCACAAAAAGGAATTGTCCAGCTCAGTAGTGC AACCAACAGCGCATCTGAAACGCTTGCCGCGACACCGAAAGCAGTGAAAGCAGCTAATGATAATGCGAATGGTCGGGTAC CTTCTGCCCGTAAGGTGAATGGTAAGGCGCTTTCATCGGATATAACACTGACGCCGAAAGATATTGGTACGCTTAACTCA ACAACAATGTCATTCAGCGGTGGTGCTGGTTGGTTCAAATTAGCAACGGTAACCATGCCACAGGCGAGTTCTGTTGTTTC AATTACGTTGATTGGTGGCGCGGGATTTAACGTGGGGTCACCTCAACAGGCAGGTATATCTGAACTTGTTTTGCGTGCAG GTAATGGTAATCCGAAGGGGATTACTGGTGCTTTATGGCAGCGCACATCGACAGGGTTTACAAATTTTGCCTGGGTCAAT ACATCTGGTGATACTTACGATATTTACGTTGCAATCGGAAATTATGCGACTGGTGTAAATATTCAATGGGATTATACCAG TAATGCCAGCGTGACGATTCATACGTCACCAGCATATTCTGCTAATAAGCCGGAAGGGTTAACGGACGGTACAGTTTATT CACTCTATACGCCATCAGAGCAGTTTTATCCGCCTGGCGCACCAATCCCGTGGCCATCAGATACCGTTCCGTCTGGCTAT GCCCTGATGCAGGGGCAGACTTTTGACAAATCTGCATACCCGAAACTTGCAGCCGCTTATCCGTCAGGCGTGATCCCTGA TATGCGTGGCTGGACGATTAAGGGCAAACCTGCCAGTGGTCGGGCCGTATTGTCTCAGGAACAGGACGGCATTAAATCGC ACACCCACAGCGCCAGCGCATCCAGTACGGATTTGGGGACGAAAACCACATCGTCGTTTGATTACGGCACTAAATCCACG AATAACACCGGGGCGCACACGCACAGTGTGAGCGGTACAGCCGCAAGTGCCGGAAACCATACTCATAGTGTCACAGGCGC ATCAGCAGTCAGCCAGTGGTCACAAAATGGGTCAGTACATAAGGTAGTGTCTGCGGCCAGTGTGAATACAAGTGCTGCAG GAGCGCACACTCATAGTGTCAGCGGCACAGCTGCATCTGCAGGTGCTCACGCACATACTGTCGGTATTGGTGCTCATACG CACTCTGTTGCGATTGGCTCACATGGACACACCATCACCGTTAACGCTGCGGGTAACGCGGAAAACACTGTCAAAAACAT CGCATTTAACTACATTGTGAGGCTTGCATAA
Upstream 100 bases:
>100_bases TGGTAGTGCGACGGCAGCAGCTCAGAGCAAAAGTACGGCGGAATCTGCAGCAACGCGCGCTGAGACAGCGGCAAAACGGG CAGAGGATATTGCATCCGCC
Downstream 100 bases:
>100_bases TGGCATTCAGAATGAGTGAACAACCACGGACCATAAAAATTTATAATCTGCTGACCGGAACTAATGAATTTATTGGTGAA GGTGACGCATATATTCCGCC
Product: prophage tail fibre domain protein
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 516; Mature: 515
Protein sequence:
>516_residues MALEDASTTKKGIVQLSSATNSTSESLAATPKAVKAAYELANGKYTAQDATTAQKGIVQLSNATNSTSEMLAATPKSVKA AYDLANGKYTAQDATTAQKGIVQLSSATNSASETLAATPKAVKAANDNANGRVPSARKVNGKALSSDITLTPKDIGTLNS TTMSFSGGAGWFKLATVTMPQASSVVSITLIGGAGFNVGSPQQAGISELVLRAGNGNPKGITGALWQRTSTGFTNFAWVN TSGDTYDIYVAIGNYATGVNIQWDYTSNASVTIHTSPAYSANKPEGLTDGTVYSLYTPSEQFYPPGAPIPWPSDTVPSGY ALMQGQTFDKSAYPKLAAAYPSGVIPDMRGWTIKGKPASGRAVLSQEQDGIKSHTHSASASSTDLGTKTTSSFDYGTKST NNTGAHTHSVSGTAASAGNHTHSVTGASAVSQWSQNGSVHKVVSAASVNTSAAGAHTHSVSGTAASAGAHAHTVGIGAHT HSVAIGSHGHTITVNAAGNAENTVKNIAFNYIVRLA
Sequences:
>Translated_516_residues MALEDASTTKKGIVQLSSATNSTSESLAATPKAVKAAYELANGKYTAQDATTAQKGIVQLSNATNSTSEMLAATPKSVKA AYDLANGKYTAQDATTAQKGIVQLSSATNSASETLAATPKAVKAANDNANGRVPSARKVNGKALSSDITLTPKDIGTLNS TTMSFSGGAGWFKLATVTMPQASSVVSITLIGGAGFNVGSPQQAGISELVLRAGNGNPKGITGALWQRTSTGFTNFAWVN TSGDTYDIYVAIGNYATGVNIQWDYTSNASVTIHTSPAYSANKPEGLTDGTVYSLYTPSEQFYPPGAPIPWPSDTVPSGY ALMQGQTFDKSAYPKLAAAYPSGVIPDMRGWTIKGKPASGRAVLSQEQDGIKSHTHSASASSTDLGTKTTSSFDYGTKST NNTGAHTHSVSGTAASAGNHTHSVTGASAVSQWSQNGSVHKVVSAASVNTSAAGAHTHSVSGTAASAGAHAHTVGIGAHT HSVAIGSHGHTITVNAAGNAENTVKNIAFNYIVRLA >Mature_515_residues ALEDASTTKKGIVQLSSATNSTSESLAATPKAVKAAYELANGKYTAQDATTAQKGIVQLSNATNSTSEMLAATPKSVKAA YDLANGKYTAQDATTAQKGIVQLSSATNSASETLAATPKAVKAANDNANGRVPSARKVNGKALSSDITLTPKDIGTLNST TMSFSGGAGWFKLATVTMPQASSVVSITLIGGAGFNVGSPQQAGISELVLRAGNGNPKGITGALWQRTSTGFTNFAWVNT SGDTYDIYVAIGNYATGVNIQWDYTSNASVTIHTSPAYSANKPEGLTDGTVYSLYTPSEQFYPPGAPIPWPSDTVPSGYA LMQGQTFDKSAYPKLAAAYPSGVIPDMRGWTIKGKPASGRAVLSQEQDGIKSHTHSASASSTDLGTKTTSSFDYGTKSTN NTGAHTHSVSGTAASAGNHTHSVTGASAVSQWSQNGSVHKVVSAASVNTSAAGAHTHSVSGTAASAGAHAHTVGIGAHTH SVAIGSHGHTITVNAAGNAENTVKNIAFNYIVRLA
Specific function: Unknown
COG id: NA
COG function: NA
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the tail fiber family [H]
Homologues:
Organism=Escherichia coli, GI87081892, Length=228, Percent_Identity=82.4561403508772, Blast_Score=344, Evalue=6e-96, Organism=Escherichia coli, GI1787829, Length=241, Percent_Identity=77.5933609958506, Blast_Score=330, Evalue=2e-91,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR008969 - InterPro: IPR014766 - InterPro: IPR011083 - InterPro: IPR005003 - InterPro: IPR013609 [H]
Pfam domain/function: PF07484 Collar; PF03335 Phage_fiber; PF08400 phage_tail_N [H]
EC number: NA
Molecular weight: Translated: 52598; Mature: 52467
Theoretical pI: Translated: 9.64; Mature: 9.64
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.0 %Cys (Translated Protein) 1.2 %Met (Translated Protein) 1.2 %Cys+Met (Translated Protein) 0.0 %Cys (Mature Protein) 1.0 %Met (Mature Protein) 1.0 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MALEDASTTKKGIVQLSSATNSTSESLAATPKAVKAAYELANGKYTAQDATTAQKGIVQL CCCCCCCCCCHHEEEEECCCCCCHHHHHCCHHHHHHHHHHCCCEEECCCCCHHHHCEEEE SNATNSTSEMLAATPKSVKAAYDLANGKYTAQDATTAQKGIVQLSSATNSASETLAATPK ECCCCCHHHHHHCCCHHHHHHEECCCCEEECCCCCHHHHCEEEEECCCCCHHHHHHCCCH AVKAANDNANGRVPSARKVNGKALSSDITLTPKDIGTLNSTTMSFSGGAGWFKLATVTMP HHEECCCCCCCCCCCCCCCCCEEECCCCEECHHHCCCCCCCEEEECCCCCEEEEEEEECC QASSVVSITLIGGAGFNVGSPQQAGISELVLRAGNGNPKGITGALWQRTSTGFTNFAWVN CCCCEEEEEEEECCCCCCCCCCCCCHHHHHEECCCCCCCCCCHHHHHCCCCCCCEEEEEE TSGDTYDIYVAIGNYATGVNIQWDYTSNASVTIHTSPAYSANKPEGLTDGTVYSLYTPSE CCCCEEEEEEEECCEEECCEEEEEECCCCEEEEECCCCCCCCCCCCCCCCEEEEEECCCH QFYPPGAPIPWPSDTVPSGYALMQGQTFDKSAYPKLAAAYPSGVIPDMRGWTIKGKPASG HCCCCCCCCCCCCCCCCCCEEEEECCCCCCCCCCCHHHCCCCCCCCCCCCCEEECCCCCC RAVLSQEQDGIKSHTHSASASSTDLGTKTTSSFDYGTKSTNNTGAHTHSVSGTAASAGNH CEEECCCCCCHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCEEEECCCCCCCCCCC THSVTGASAVSQWSQNGSVHKVVSAASVNTSAAGAHTHSVSGTAASAGAHAHTVGIGAHT CCCCCCHHHHHHHHCCCCEEEEEEECCCCCCCCCCEECCCCCCCCCCCCCEEEEEECCCE HSVAIGSHGHTITVNAAGNAENTVKNIAFNYIVRLA EEEEECCCCCEEEEEECCCCHHHHHHHEEEEEEEEC >Mature Secondary Structure ALEDASTTKKGIVQLSSATNSTSESLAATPKAVKAAYELANGKYTAQDATTAQKGIVQL CCCCCCCCCHHEEEEECCCCCCHHHHHCCHHHHHHHHHHCCCEEECCCCCHHHHCEEEE SNATNSTSEMLAATPKSVKAAYDLANGKYTAQDATTAQKGIVQLSSATNSASETLAATPK ECCCCCHHHHHHCCCHHHHHHEECCCCEEECCCCCHHHHCEEEEECCCCCHHHHHHCCCH AVKAANDNANGRVPSARKVNGKALSSDITLTPKDIGTLNSTTMSFSGGAGWFKLATVTMP HHEECCCCCCCCCCCCCCCCCEEECCCCEECHHHCCCCCCCEEEECCCCCEEEEEEEECC QASSVVSITLIGGAGFNVGSPQQAGISELVLRAGNGNPKGITGALWQRTSTGFTNFAWVN CCCCEEEEEEEECCCCCCCCCCCCCHHHHHEECCCCCCCCCCHHHHHCCCCCCCEEEEEE TSGDTYDIYVAIGNYATGVNIQWDYTSNASVTIHTSPAYSANKPEGLTDGTVYSLYTPSE CCCCEEEEEEEECCEEECCEEEEEECCCCEEEEECCCCCCCCCCCCCCCCEEEEEECCCH QFYPPGAPIPWPSDTVPSGYALMQGQTFDKSAYPKLAAAYPSGVIPDMRGWTIKGKPASG HCCCCCCCCCCCCCCCCCCEEEEECCCCCCCCCCCHHHCCCCCCCCCCCCCEEECCCCCC RAVLSQEQDGIKSHTHSASASSTDLGTKTTSSFDYGTKSTNNTGAHTHSVSGTAASAGNH CEEECCCCCCHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCEEEECCCCCCCCCCC THSVTGASAVSQWSQNGSVHKVVSAASVNTSAAGAHTHSVSGTAASAGAHAHTVGIGAHT CCCCCCHHHHHHHHCCCCEEEEEEECCCCCCCCCCEECCCCCCCCCCCCCEEEEEECCCE HSVAIGSHGHTITVNAAGNAENTVKNIAFNYIVRLA EEEEECCCCCEEEEEECCCCHHHHHHHEEEEEEEEC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 9097039; 9278503 [H]