| Definition | Escherichia coli O157:H7 str. EC4115, complete genome. |
|---|---|
| Accession | NC_011353 |
| Length | 5,572,075 |
Click here to switch to the map view.
The map label for this gene is nrfE [H]
Identifier: 209397457
GI number: 209397457
Start: 5219841
End: 5221520
Strand: Direct
Name: nrfE [H]
Synonym: ECH74115_5579
Alternate gene names: 209397457
Gene position: 5219841-5221520 (Clockwise)
Preceding gene: 209398055
Following gene: 209398766
Centisome position: 93.68
GC content: 56.61
Gene sequence:
>1680_bases TTGTTAAGTCTCGGGGTCAACGTGTTGACCCCGTTGACGGCCTTTGCGGGAGTGCGGTTGCGCTGGCCTGCCATGATGCG ACTCACTTGCATCGGCATTCTGGCACAGTTCGCGCTCCTGCTGCTCGCCTTTGGCGTACTGACGTATTGTTTTCTCATCA GCGATTTCTCGGTCATTTATGTCGCCCAACATAGCTACAGCTTGCTGTCGTGGAAACTCAAACTGGCGGCGGTGTGGGGC GGTCATGAAGGTTCGCTGCTGCTTTGGGTGCTGCTGCTTTCCGCCTGGAGCGCGCTGTTTGCCTGGCAATATCGGCAGCA AACCGATCCGCTATTTCCGCTGACGCTAGCCGTTTTATCTCTCATGCTCGCCGCACTGCTACTGTTTGTAGTGCTGTGGT CCGATCCCTTCGTGCGGATATTTCCACCAGCAATCGAAGGCCGCGATCTCAATCCGATGCTGCAACATCCCGGTCTTATC TTTCATCCACCGCTGCTTTACCTTGGCTATGGCGGTTTGATGGTAGCGGCGAGCGTGGCGCTGGCGAGTCTACTGCGCGG CGAGTTTGATGGTGCCTGCGCCCGAATTTGCTGGCGCTGGGCGTTACCTGGCTGGAGTGCATTAACTGCGGGGATCATCC TCGGTTCCTGGTGGGCCTACTGCGAACTCGGCTGGGGCGGCTGGTGGTTCTGGGATCCGGTGGAAAACGCCTCTTTATTA CCCTGGCTTTCTGCCACTGCGCTGCTGCACAGTTTATCCCTGACACGCCAGCGGGGGATTTTTCGCCACTGGTCGCTGTT GTTGGCGATAGTTACTCTGATGCTGTCGCTGCTGGGCACCTTAATTGTCCGTTCTGGCATTCTGGTTTCGGTTCATGCGT TCGCTCTGGATAACGTTCGCGCTGTGCCGTTGTTCAGCCTGTTTGCACTGATTAGCCTTGCGTCTCTGGCTCTGTATGGC TGGCGAGCGCGGGACGGTGGCCCGGCGGTGCGTTTTTCGGGGTTATCGCGGGAAATGTTAATCCTCGCTACGCTGTTGCT GTTTTGCGCAGTGCTACTGATCGTGCTGGTGGGAACGCTTTATCCGATGATTTACGGCCTGCTGGGCTGGGGACGTCTCT CCGTTGGCGCACCGTATTTTAACCGCGCGACGTTACCGTTTGGTCTGTTGATGTTGGTGGTGATTGTGCTGGCGACGTTT GTCTCTGGCAAACGCGCGCAGCTTCCGGCGCTGCTGGCGCATGCGGGCATACTGTTATTTGCCGCAGGGATCGTTGTCTC CAGCGTCAGCCGTCAGGAGATCAGCCTGAATTTACAGCCGGGTCAGCAGGTGACGCTGGCAGGATACACCTTCCGTTTTG AGCGCCTCGATCTGCAAGCCAAAGGCAATTACACCAGCGAAAAAGCGATAGTGGCGCTGTTTGACCATCAGCAACGCATT GGTGAATTAACGCCGGAGCGGCGTTTTTACGAAGCTCGTCGTCAGCAAATGATGGAACCGTCAATTCGCTGGAACGGCAT CCATGACTGGTATGCGGTCATGGGGGAGAAAACTGGAGCGGATCGTTACGCTTTTCGCTTGTATGTACAAAGCGGTGTGC GCTGGATCTGGGGGGGAGGATTGTTGATGATTGCGGGCGCATTGTTAAGCGGATGGCGGGGGAAGAAGCGCGATGTATAA
Upstream 100 bases:
>100_bases CGATTTTTCATTCTCTACGCCGGGCAGTTAACGGTGGCGTAAGCCAGAACAGAGGTGGTTTCTGGACGTATTCCTTCCTG AAGTCGGTTTTCTGGCGCTG
Downstream 100 bases:
>100_bases AGGGCTTCTCACGCTACTGCTGTTATTTACCTGTTTTGCGCGCGCTCAGGTTGTAGACACCTGGCAATTCGCCAATCCGC AACAACAGCAACAGGCGTTA
Product: heme lyase subunit NrfE
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 559; Mature: 559
Protein sequence:
>559_residues MLSLGVNVLTPLTAFAGVRLRWPAMMRLTCIGILAQFALLLLAFGVLTYCFLISDFSVIYVAQHSYSLLSWKLKLAAVWG GHEGSLLLWVLLLSAWSALFAWQYRQQTDPLFPLTLAVLSLMLAALLLFVVLWSDPFVRIFPPAIEGRDLNPMLQHPGLI FHPPLLYLGYGGLMVAASVALASLLRGEFDGACARICWRWALPGWSALTAGIILGSWWAYCELGWGGWWFWDPVENASLL PWLSATALLHSLSLTRQRGIFRHWSLLLAIVTLMLSLLGTLIVRSGILVSVHAFALDNVRAVPLFSLFALISLASLALYG WRARDGGPAVRFSGLSREMLILATLLLFCAVLLIVLVGTLYPMIYGLLGWGRLSVGAPYFNRATLPFGLLMLVVIVLATF VSGKRAQLPALLAHAGILLFAAGIVVSSVSRQEISLNLQPGQQVTLAGYTFRFERLDLQAKGNYTSEKAIVALFDHQQRI GELTPERRFYEARRQQMMEPSIRWNGIHDWYAVMGEKTGADRYAFRLYVQSGVRWIWGGGLLMIAGALLSGWRGKKRDV
Sequences:
>Translated_559_residues MLSLGVNVLTPLTAFAGVRLRWPAMMRLTCIGILAQFALLLLAFGVLTYCFLISDFSVIYVAQHSYSLLSWKLKLAAVWG GHEGSLLLWVLLLSAWSALFAWQYRQQTDPLFPLTLAVLSLMLAALLLFVVLWSDPFVRIFPPAIEGRDLNPMLQHPGLI FHPPLLYLGYGGLMVAASVALASLLRGEFDGACARICWRWALPGWSALTAGIILGSWWAYCELGWGGWWFWDPVENASLL PWLSATALLHSLSLTRQRGIFRHWSLLLAIVTLMLSLLGTLIVRSGILVSVHAFALDNVRAVPLFSLFALISLASLALYG WRARDGGPAVRFSGLSREMLILATLLLFCAVLLIVLVGTLYPMIYGLLGWGRLSVGAPYFNRATLPFGLLMLVVIVLATF VSGKRAQLPALLAHAGILLFAAGIVVSSVSRQEISLNLQPGQQVTLAGYTFRFERLDLQAKGNYTSEKAIVALFDHQQRI GELTPERRFYEARRQQMMEPSIRWNGIHDWYAVMGEKTGADRYAFRLYVQSGVRWIWGGGLLMIAGALLSGWRGKKRDV >Mature_559_residues MLSLGVNVLTPLTAFAGVRLRWPAMMRLTCIGILAQFALLLLAFGVLTYCFLISDFSVIYVAQHSYSLLSWKLKLAAVWG GHEGSLLLWVLLLSAWSALFAWQYRQQTDPLFPLTLAVLSLMLAALLLFVVLWSDPFVRIFPPAIEGRDLNPMLQHPGLI FHPPLLYLGYGGLMVAASVALASLLRGEFDGACARICWRWALPGWSALTAGIILGSWWAYCELGWGGWWFWDPVENASLL PWLSATALLHSLSLTRQRGIFRHWSLLLAIVTLMLSLLGTLIVRSGILVSVHAFALDNVRAVPLFSLFALISLASLALYG WRARDGGPAVRFSGLSREMLILATLLLFCAVLLIVLVGTLYPMIYGLLGWGRLSVGAPYFNRATLPFGLLMLVVIVLATF VSGKRAQLPALLAHAGILLFAAGIVVSSVSRQEISLNLQPGQQVTLAGYTFRFERLDLQAKGNYTSEKAIVALFDHQQRI GELTPERRFYEARRQQMMEPSIRWNGIHDWYAVMGEKTGADRYAFRLYVQSGVRWIWGGGLLMIAGALLSGWRGKKRDV
Specific function: May be required for the biogenesis of c-type cytochromes. Possible subunit of a heme lyase [H]
COG id: COG1138
COG function: function code O; Cytochrome c biogenesis factor
Gene ontology:
Cell location: Cell inner membrane; Multi-pass membrane protein [H]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the ccmF/cycK/ccl1/nrfE/ccsA family [H]
Homologues:
Organism=Escherichia coli, GI1790511, Length=551, Percent_Identity=98.0036297640653, Blast_Score=1064, Evalue=0.0, Organism=Escherichia coli, GI1788524, Length=585, Percent_Identity=38.6324786324786, Blast_Score=336, Evalue=2e-93,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR002541 - InterPro: IPR003567 - InterPro: IPR003568 - InterPro: IPR003570 [H]
Pfam domain/function: PF01578 Cytochrom_C_asm [H]
EC number: NA
Molecular weight: Translated: 62051; Mature: 62051
Theoretical pI: Translated: 10.04; Mature: 10.04
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.1 %Cys (Translated Protein) 2.5 %Met (Translated Protein) 3.6 %Cys+Met (Translated Protein) 1.1 %Cys (Mature Protein) 2.5 %Met (Mature Protein) 3.6 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MLSLGVNVLTPLTAFAGVRLRWPAMMRLTCIGILAQFALLLLAFGVLTYCFLISDFSVIY CCCCCCHHHHHHHHHCCCEEECHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCEEE VAQHSYSLLSWKLKLAAVWGGHEGSLLLWVLLLSAWSALFAWQYRQQTDPLFPLTLAVLS EECCCHHHHHHEEEEEEEECCCCCHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHH LMLAALLLFVVLWSDPFVRIFPPAIEGRDLNPMLQHPGLIFHPPLLYLGYGGLMVAASVA HHHHHHHHHHHHHCCCCEEECCCCCCCCCCCHHHHCCCEEECCCHHHHCCHHHHHHHHHH LASLLRGEFDGACARICWRWALPGWSALTAGIILGSWWAYCELGWGGWWFWDPVENASLL HHHHHHCCCCHHHHHHHHHHCCCCHHHHHHHHHHHCHHHHEEECCCCEEEECCCCCCCCC PWLSATALLHSLSLTRQRGIFRHWSLLLAIVTLMLSLLGTLIVRSGILVSVHAFALDNVR HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHEEEHHHHHCCCC AVPLFSLFALISLASLALYGWRARDGGPAVRFSGLSREMLILATLLLFCAVLLIVLVGTL HHHHHHHHHHHHHHHHHHHCCCCCCCCCEEEECCCCHHHHHHHHHHHHHHHHHHHHHHHH YPMIYGLLGWGRLSVGAPYFNRATLPFGLLMLVVIVLATFVSGKRAQLPALLAHAGILLF HHHHHHHHCCCHHCCCCCCCCCCCHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHH AAGIVVSSVSRQEISLNLQPGQQVTLAGYTFRFERLDLQAKGNYTSEKAIVALFDHQQRI HHHHHHHHCCHHHEEEEECCCCEEEEEEEEEEEEEEEEEECCCCCCCHHEEEEHHHHHHH GELTPERRFYEARRQQMMEPSIRWNGIHDWYAVMGEKTGADRYAFRLYVQSGVRWIWGGG HCCCHHHHHHHHHHHHHCCCCCCCCCCHHHHHHHCCCCCCCHHHEEEEHHHCCEEEECCC LLMIAGALLSGWRGKKRDV HHHHHHHHHHCCCCCCCCC >Mature Secondary Structure MLSLGVNVLTPLTAFAGVRLRWPAMMRLTCIGILAQFALLLLAFGVLTYCFLISDFSVIY CCCCCCHHHHHHHHHCCCEEECHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCEEE VAQHSYSLLSWKLKLAAVWGGHEGSLLLWVLLLSAWSALFAWQYRQQTDPLFPLTLAVLS EECCCHHHHHHEEEEEEEECCCCCHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHH LMLAALLLFVVLWSDPFVRIFPPAIEGRDLNPMLQHPGLIFHPPLLYLGYGGLMVAASVA HHHHHHHHHHHHHCCCCEEECCCCCCCCCCCHHHHCCCEEECCCHHHHCCHHHHHHHHHH LASLLRGEFDGACARICWRWALPGWSALTAGIILGSWWAYCELGWGGWWFWDPVENASLL HHHHHHCCCCHHHHHHHHHHCCCCHHHHHHHHHHHCHHHHEEECCCCEEEECCCCCCCCC PWLSATALLHSLSLTRQRGIFRHWSLLLAIVTLMLSLLGTLIVRSGILVSVHAFALDNVR HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHEEEHHHHHCCCC AVPLFSLFALISLASLALYGWRARDGGPAVRFSGLSREMLILATLLLFCAVLLIVLVGTL HHHHHHHHHHHHHHHHHHHCCCCCCCCCEEEECCCCHHHHHHHHHHHHHHHHHHHHHHHH YPMIYGLLGWGRLSVGAPYFNRATLPFGLLMLVVIVLATFVSGKRAQLPALLAHAGILLF HHHHHHHHCCCHHCCCCCCCCCCCHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHH AAGIVVSSVSRQEISLNLQPGQQVTLAGYTFRFERLDLQAKGNYTSEKAIVALFDHQQRI HHHHHHHHCCHHHEEEEECCCCEEEEEEEEEEEEEEEEEECCCCCCCHHEEEEHHHHHHH GELTPERRFYEARRQQMMEPSIRWNGIHDWYAVMGEKTGADRYAFRLYVQSGVRWIWGGG HCCCHHHHHHHHHHHHHCCCCCCCCCCHHHHHHHCCCCCCCHHHEEEEHHHCCEEEECCC LLMIAGALLSGWRGKKRDV HHHHHHHHHHCCCCCCCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 6.0
TargetDB status: NA
Availability: NA
References: 8057835; 8265357; 9278503 [H]