The gene/protein map for NC_011745 is currently unavailable.
Definition Escherichia coli ED1a chromosome, complete genome.
Accession NC_011745
Length 5,209,548

Click here to switch to the map view.

The map label for this gene is stfR [H]

Identifier: 218689247

GI number: 218689247

Start: 1434001

End: 1435509

Strand: Direct

Name: stfR [H]

Synonym: ECED1_1464

Alternate gene names: 218689247

Gene position: 1434001-1435509 (Clockwise)

Preceding gene: 218689246

Following gene: 218689248

Centisome position: 27.53

GC content: 61.9

Gene sequence:

>1509_bases
ATGACAGTCAGAATATCGGGCGTGCTGAAGGACGGCACCGGGAAGCCGGTGCCGGGATGCACCATAGAGCTGAAAGCGCG
ACGCACCACAGAGACAGTGATAGTCACCACGGTGGCGCAGGGGCAGCCGGGGGAAACCGGCAGTTACAGTTTTGATGTGG
AGCCGGGGTGGTACCGGGTGACGCTGAACACGGAAGGGTACGCCCCGTCGTATGTGGGTGACATTCTGGTGAAGGCGGAT
TCTGAGCCGGGAACGCTGAATAAATTTCTGATGGAACAGGATGAGGCGCAGTATTACCCGAAAGCGCTTGCAGAGCTGGA
AGCGGTGGCAGCGGAAATCCTGAAGCGTGCTGAAGCGTCGGCGGCGAGTGCAGAGGAAGCGAAGAAACGGGCAGAGAATG
CCCGGGGACCGGCGGGCGAGAAGGGAGACACAGGTCCACAGGGTGCCACAGGGGCACAGGGACCAGCCGGGGCAACGGGG
GCGGTCGGACCAAAAGGTGAGCCGGGGCCAAAGGGAGAACGGGGAGAAACAGGTCCACAGGGACCGAAGGGCGATAAAGG
TGACCCGGGCGGACCGCCGGGGCCGAAAGGTGACACCGGCCCACGTGGAGAGGCCGGACCACCCGGACCACAGGGTCCGG
CAGGGCAAACCGGCCCGAAAGGGGATAAAGGTGAACCCGGCGCAACAGGTCCGGCAGGTCCCGCAGGCCCTCGGGGAGAA
ACCGGCCCCGCAGGTCCTGCGGGTCCCGCAGGCAGTGTCGCCAGTGTTCCGGATGCCAGCACATCACAGAAAGGTGTTGT
ACAGCTGAGCAGCGATACCAACAGCGATGATGAAACAAAAGCGGCAACCCCAAAGGCTGTGAAAGCGGTAATGGCAGAAG
TGCAGGCGGCAAAAACGAAGGCAGAAGAGGCAGCAACCCGGGCAGCAGTCCCCGGACCGAAGGGGGACAGGGGGGAACCT
GGCGCACCTGGTGCAGTGGGGCCCGCAGGCCCACGGGGACCGGCTGGTGCAGCTGGTCCCAAAGGTGATGCAGGCCCGGC
AGGGCCACGAGGTGAAAGGGGACCTGCGGGGGCACAGGGTGTTCCGGGGCCGGTTGGTCCGGCAGGTCCTGCGGGTAAAA
CGGGGCCACGAGGTTTGCAGGGAGAAACAGGAAGACAGGGCCCGACAGGTCCACAGGGCCCGACAGGTGAACCCGGACCA
CAGGGACCACAAGGGCCAACCGGAAGGCTGGTACCCGGGGAAATTTACAGCATCGGAACATACATTATTGCCGCACTAGC
CCCGTATACAACCGACATCGGCAGAACCTATCAGCCAGGAGAAACTGTACAGGGTTCACGCCTTAAGCGATGCGCCATAA
TCAAAGATGCAAGCGGGAACTATATGAAAGCTAACACCGATGGCATTGACGGCAACCTATCCTCAGTTCCGGGCTCATGG
ATGGTGTGTAATGAAATTACGTCGACAAATGACAATGAAGGCATCGGGCTGTTCCAGCGCGCATACTGA

Upstream 100 bases:

>100_bases
TCCGCCTCATGTGATGAACTGCGTTTGAGGAAACGTAAAGTTACACTGTCCTGAAGCCCGTGGCGTCACTGCTGCGGGCT
TTTTTTTATGGGAGAAATCT

Downstream 100 bases:

>100_bases
CAGACAGGAGATGACATGAATGTGGAAAAAAATAAGCAATCCGCAATGGGCAGATAAAGATCACACTGCTGTTAATTGCA
TGGTGAAGTTTGAGCACATT

Product: putative tail fiber protein from phage origin

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 502; Mature: 501

Protein sequence:

>502_residues
MTVRISGVLKDGTGKPVPGCTIELKARRTTETVIVTTVAQGQPGETGSYSFDVEPGWYRVTLNTEGYAPSYVGDILVKAD
SEPGTLNKFLMEQDEAQYYPKALAELEAVAAEILKRAEASAASAEEAKKRAENARGPAGEKGDTGPQGATGAQGPAGATG
AVGPKGEPGPKGERGETGPQGPKGDKGDPGGPPGPKGDTGPRGEAGPPGPQGPAGQTGPKGDKGEPGATGPAGPAGPRGE
TGPAGPAGPAGSVASVPDASTSQKGVVQLSSDTNSDDETKAATPKAVKAVMAEVQAAKTKAEEAATRAAVPGPKGDRGEP
GAPGAVGPAGPRGPAGAAGPKGDAGPAGPRGERGPAGAQGVPGPVGPAGPAGKTGPRGLQGETGRQGPTGPQGPTGEPGP
QGPQGPTGRLVPGEIYSIGTYIIAALAPYTTDIGRTYQPGETVQGSRLKRCAIIKDASGNYMKANTDGIDGNLSSVPGSW
MVCNEITSTNDNEGIGLFQRAY

Sequences:

>Translated_502_residues
MTVRISGVLKDGTGKPVPGCTIELKARRTTETVIVTTVAQGQPGETGSYSFDVEPGWYRVTLNTEGYAPSYVGDILVKAD
SEPGTLNKFLMEQDEAQYYPKALAELEAVAAEILKRAEASAASAEEAKKRAENARGPAGEKGDTGPQGATGAQGPAGATG
AVGPKGEPGPKGERGETGPQGPKGDKGDPGGPPGPKGDTGPRGEAGPPGPQGPAGQTGPKGDKGEPGATGPAGPAGPRGE
TGPAGPAGPAGSVASVPDASTSQKGVVQLSSDTNSDDETKAATPKAVKAVMAEVQAAKTKAEEAATRAAVPGPKGDRGEP
GAPGAVGPAGPRGPAGAAGPKGDAGPAGPRGERGPAGAQGVPGPVGPAGPAGKTGPRGLQGETGRQGPTGPQGPTGEPGP
QGPQGPTGRLVPGEIYSIGTYIIAALAPYTTDIGRTYQPGETVQGSRLKRCAIIKDASGNYMKANTDGIDGNLSSVPGSW
MVCNEITSTNDNEGIGLFQRAY
>Mature_501_residues
TVRISGVLKDGTGKPVPGCTIELKARRTTETVIVTTVAQGQPGETGSYSFDVEPGWYRVTLNTEGYAPSYVGDILVKADS
EPGTLNKFLMEQDEAQYYPKALAELEAVAAEILKRAEASAASAEEAKKRAENARGPAGEKGDTGPQGATGAQGPAGATGA
VGPKGEPGPKGERGETGPQGPKGDKGDPGGPPGPKGDTGPRGEAGPPGPQGPAGQTGPKGDKGEPGATGPAGPAGPRGET
GPAGPAGPAGSVASVPDASTSQKGVVQLSSDTNSDDETKAATPKAVKAVMAEVQAAKTKAEEAATRAAVPGPKGDRGEPG
APGAVGPAGPRGPAGAAGPKGDAGPAGPRGERGPAGAQGVPGPVGPAGPAGKTGPRGLQGETGRQGPTGPQGPTGEPGPQ
GPQGPTGRLVPGEIYSIGTYIIAALAPYTTDIGRTYQPGETVQGSRLKRCAIIKDASGNYMKANTDGIDGNLSSVPGSWM
VCNEITSTNDNEGIGLFQRAY

Specific function: Unknown

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the tail fiber family [H]

Homologues:

Organism=Homo sapiens, GI183583553, Length=293, Percent_Identity=36.1774744027304, Blast_Score=136, Evalue=5e-32,
Organism=Homo sapiens, GI89363017, Length=280, Percent_Identity=41.0714285714286, Blast_Score=95, Evalue=2e-19,
Organism=Homo sapiens, GI115392133, Length=296, Percent_Identity=36.4864864864865, Blast_Score=94, Evalue=4e-19,
Organism=Homo sapiens, GI115527062, Length=264, Percent_Identity=40.1515151515151, Blast_Score=92, Evalue=1e-18,
Organism=Homo sapiens, GI115527070, Length=264, Percent_Identity=40.1515151515151, Blast_Score=90, Evalue=6e-18,
Organism=Homo sapiens, GI115527066, Length=264, Percent_Identity=40.1515151515151, Blast_Score=89, Evalue=7e-18,
Organism=Homo sapiens, GI65301115, Length=185, Percent_Identity=41.0810810810811, Blast_Score=87, Evalue=2e-17,
Organism=Homo sapiens, GI5803080, Length=308, Percent_Identity=37.012987012987, Blast_Score=87, Evalue=3e-17,
Organism=Homo sapiens, GI56847616, Length=152, Percent_Identity=46.0526315789474, Blast_Score=87, Evalue=4e-17,
Organism=Homo sapiens, GI111118976, Length=278, Percent_Identity=40.6474820143885, Blast_Score=86, Evalue=6e-17,
Organism=Homo sapiens, GI4502961, Length=279, Percent_Identity=36.5591397849462, Blast_Score=85, Evalue=2e-16,
Organism=Homo sapiens, GI32140760, Length=311, Percent_Identity=35.6913183279743, Blast_Score=84, Evalue=3e-16,
Organism=Homo sapiens, GI111118974, Length=278, Percent_Identity=40.6474820143885, Blast_Score=84, Evalue=3e-16,
Organism=Homo sapiens, GI40805823, Length=397, Percent_Identity=28.2115869017632, Blast_Score=80, Evalue=4e-15,
Organism=Homo sapiens, GI154759255, Length=253, Percent_Identity=36.3636363636364, Blast_Score=79, Evalue=9e-15,
Organism=Homo sapiens, GI38570073, Length=340, Percent_Identity=35, Blast_Score=79, Evalue=1e-14,
Organism=Homo sapiens, GI38570075, Length=340, Percent_Identity=34.7058823529412, Blast_Score=78, Evalue=2e-14,
Organism=Homo sapiens, GI122937273, Length=237, Percent_Identity=36.2869198312236, Blast_Score=78, Evalue=2e-14,
Organism=Homo sapiens, GI110735435, Length=330, Percent_Identity=35.7575757575758, Blast_Score=78, Evalue=2e-14,
Organism=Homo sapiens, GI299523257, Length=353, Percent_Identity=33.9943342776204, Blast_Score=78, Evalue=2e-14,
Organism=Homo sapiens, GI111118970, Length=221, Percent_Identity=39.8190045248869, Blast_Score=77, Evalue=5e-14,
Organism=Homo sapiens, GI111118968, Length=221, Percent_Identity=39.8190045248869, Blast_Score=77, Evalue=5e-14,
Organism=Homo sapiens, GI111118972, Length=221, Percent_Identity=39.8190045248869, Blast_Score=76, Evalue=6e-14,
Organism=Homo sapiens, GI299523253, Length=353, Percent_Identity=33.9943342776204, Blast_Score=76, Evalue=7e-14,
Organism=Homo sapiens, GI18780273, Length=279, Percent_Identity=36.2007168458781, Blast_Score=76, Evalue=7e-14,
Organism=Homo sapiens, GI98985806, Length=279, Percent_Identity=39.7849462365591, Blast_Score=75, Evalue=2e-13,
Organism=Homo sapiens, GI98985810, Length=279, Percent_Identity=39.7849462365591, Blast_Score=74, Evalue=4e-13,
Organism=Homo sapiens, GI119829187, Length=242, Percent_Identity=36.7768595041322, Blast_Score=73, Evalue=6e-13,
Organism=Homo sapiens, GI18105016, Length=97, Percent_Identity=50.5154639175258, Blast_Score=73, Evalue=7e-13,
Organism=Homo sapiens, GI73486666, Length=314, Percent_Identity=34.3949044585987, Blast_Score=73, Evalue=7e-13,
Organism=Homo sapiens, GI18105018, Length=97, Percent_Identity=50.5154639175258, Blast_Score=72, Evalue=1e-12,
Organism=Homo sapiens, GI11386161, Length=305, Percent_Identity=36.0655737704918, Blast_Score=72, Evalue=2e-12,
Organism=Homo sapiens, GI55743098, Length=103, Percent_Identity=46.6019417475728, Blast_Score=71, Evalue=2e-12,
Organism=Homo sapiens, GI145701009, Length=97, Percent_Identity=50.5154639175258, Blast_Score=71, Evalue=2e-12,
Organism=Homo sapiens, GI55743106, Length=103, Percent_Identity=46.6019417475728, Blast_Score=70, Evalue=3e-12,
Organism=Homo sapiens, GI240255535, Length=103, Percent_Identity=46.6019417475728, Blast_Score=70, Evalue=4e-12,
Organism=Homo sapiens, GI156616290, Length=292, Percent_Identity=30.8219178082192, Blast_Score=70, Evalue=4e-12,
Organism=Homo sapiens, GI48762934, Length=250, Percent_Identity=39.6, Blast_Score=70, Evalue=7e-12,
Organism=Homo sapiens, GI116256354, Length=301, Percent_Identity=36.2126245847176, Blast_Score=68, Evalue=2e-11,
Organism=Homo sapiens, GI4502951, Length=307, Percent_Identity=36.4820846905537, Blast_Score=67, Evalue=3e-11,
Organism=Homo sapiens, GI47778921, Length=403, Percent_Identity=31.0173697270471, Blast_Score=67, Evalue=4e-11,
Organism=Escherichia coli, GI87081892, Length=123, Percent_Identity=53.6585365853659, Blast_Score=129, Evalue=4e-31,
Organism=Caenorhabditis elegans, GI71992048, Length=293, Percent_Identity=38.2252559726962, Blast_Score=91, Evalue=2e-18,
Organism=Caenorhabditis elegans, GI17569903, Length=103, Percent_Identity=48.5436893203884, Blast_Score=65, Evalue=6e-11,
Organism=Drosophila melanogaster, GI24581820, Length=335, Percent_Identity=35.2238805970149, Blast_Score=81, Evalue=1e-15,
Organism=Drosophila melanogaster, GI24581822, Length=335, Percent_Identity=35.2238805970149, Blast_Score=81, Evalue=1e-15,
Organism=Drosophila melanogaster, GI24581824, Length=335, Percent_Identity=35.2238805970149, Blast_Score=81, Evalue=1e-15,
Organism=Drosophila melanogaster, GI17137252, Length=308, Percent_Identity=35.3896103896104, Blast_Score=78, Evalue=1e-14,
Organism=Drosophila melanogaster, GI221379525, Length=116, Percent_Identity=43.1034482758621, Blast_Score=67, Evalue=4e-11,
Organism=Drosophila melanogaster, GI221379533, Length=116, Percent_Identity=43.1034482758621, Blast_Score=66, Evalue=5e-11,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR008969
- InterPro:   IPR014766
- InterPro:   IPR011083
- InterPro:   IPR005003
- InterPro:   IPR013609 [H]

Pfam domain/function: PF07484 Collar; PF03335 Phage_fiber; PF08400 phage_tail_N [H]

EC number: NA

Molecular weight: Translated: 49525; Mature: 49394

Theoretical pI: Translated: 5.14; Mature: 5.14

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.6 %Cys     (Translated Protein)
1.0 %Met     (Translated Protein)
1.6 %Cys+Met (Translated Protein)
0.6 %Cys     (Mature Protein)
0.8 %Met     (Mature Protein)
1.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MTVRISGVLKDGTGKPVPGCTIELKARRTTETVIVTTVAQGQPGETGSYSFDVEPGWYRV
CEEEEEEEEECCCCCCCCCCEEEEEECCCCEEEEEEEECCCCCCCCCCEEEECCCCEEEE
TLNTEGYAPSYVGDILVKADSEPGTLNKFLMEQDEAQYYPKALAELEAVAAEILKRAEAS
EECCCCCCCHHHCEEEEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
AASAEEAKKRAENARGPAGEKGDTGPQGATGAQGPAGATGAVGPKGEPGPKGERGETGPQ
HHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC
GPKGDKGDPGGPPGPKGDTGPRGEAGPPGPQGPAGQTGPKGDKGEPGATGPAGPAGPRGE
CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC
TGPAGPAGPAGSVASVPDASTSQKGVVQLSSDTNSDDETKAATPKAVKAVMAEVQAAKTK
CCCCCCCCCCCCCCCCCCCCCCCCCEEEECCCCCCCCHHHHCCHHHHHHHHHHHHHHHHH
AEEAATRAAVPGPKGDRGEPGAPGAVGPAGPRGPAGAAGPKGDAGPAGPRGERGPAGAQG
HHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC
VPGPVGPAGPAGKTGPRGLQGETGRQGPTGPQGPTGEPGPQGPQGPTGRLVPGEIYSIGT
CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHH
YIIAALAPYTTDIGRTYQPGETVQGSRLKRCAIIKDASGNYMKANTDGIDGNLSSVPGSW
HHHHHHHHHHHHCCCCCCCCCCCCCCCCCEEEEEECCCCCEEECCCCCCCCCHHCCCCCE
MVCNEITSTNDNEGIGLFQRAY
EEECCCCCCCCCCCCCHHHHCC
>Mature Secondary Structure 
TVRISGVLKDGTGKPVPGCTIELKARRTTETVIVTTVAQGQPGETGSYSFDVEPGWYRV
EEEEEEEEECCCCCCCCCCEEEEEECCCCEEEEEEEECCCCCCCCCCEEEECCCCEEEE
TLNTEGYAPSYVGDILVKADSEPGTLNKFLMEQDEAQYYPKALAELEAVAAEILKRAEAS
EECCCCCCCHHHCEEEEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
AASAEEAKKRAENARGPAGEKGDTGPQGATGAQGPAGATGAVGPKGEPGPKGERGETGPQ
HHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC
GPKGDKGDPGGPPGPKGDTGPRGEAGPPGPQGPAGQTGPKGDKGEPGATGPAGPAGPRGE
CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC
TGPAGPAGPAGSVASVPDASTSQKGVVQLSSDTNSDDETKAATPKAVKAVMAEVQAAKTK
CCCCCCCCCCCCCCCCCCCCCCCCCEEEECCCCCCCCHHHHCCHHHHHHHHHHHHHHHHH
AEEAATRAAVPGPKGDRGEPGAPGAVGPAGPRGPAGAAGPKGDAGPAGPRGERGPAGAQG
HHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC
VPGPVGPAGPAGKTGPRGLQGETGRQGPTGPQGPTGEPGPQGPQGPTGRLVPGEIYSIGT
CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHH
YIIAALAPYTTDIGRTYQPGETVQGSRLKRCAIIKDASGNYMKANTDGIDGNLSSVPGSW
HHHHHHHHHHHHCCCCCCCCCCCCCCCCCEEEEEECCCCCEEECCCCCCCCCHHCCCCCE
MVCNEITSTNDNEGIGLFQRAY
EEECCCCCCCCCCCCCHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 9097039; 9278503 [H]