| Definition | Escherichia coli HS, complete genome. |
|---|---|
| Accession | NC_009800 |
| Length | 4,643,538 |
Click here to switch to the map view.
The map label for this gene is yeaW
Identifier: 157161266
GI number: 157161266
Start: 1902867
End: 1903991
Strand: Direct
Name: yeaW
Synonym: EcHS_A1890
Alternate gene names: 157161266
Gene position: 1902867-1903991 (Clockwise)
Preceding gene: 157161265
Following gene: 157161267
Centisome position: 40.98
GC content: 51.73
Gene sequence:
>1125_bases ATGAGCAATCTGAGCCCTGACTTTGTACTACCCGAAAATTTTTGCGCTAACCCGCAAGAGGCGTGGACCATTCCTGCCCG TTTTTATACCGATCAGAACGCGTTTGAACACGAAAAAGAGAACGTCTTCGCCAAAAGCTGGATTTGCGTCGCTCACAGCA GCGAACTGGCGAATGCCAATGATTATGTGACGCGTGAGATCATTGGCGAAAGCATCGTGCTGGTACGCGGTCGTGATAAG GTTTTGCGCGCGTTCTATAACGTGTGTCCGCACCGTGGTCATCAGTTGTTGAGCGGTGAAGGAAAAGCAAAAAATGTGAT TACCTGCCCGTATCACGCATGGGCATTCAAACTCGATGGCAACCTGGCCCATGCACGTAACTGCGAAAACGTCGCCAATT TCGATAGCGACAAAGCGCAACTGGTTCCGGTGCGTCTGGAAGAATATGCCGGATTCGTCTTCATCAACATGGACCCCAAC GCCACCAGCGTAGAAGATCAATTACCCGGCCTGGGCGCGAAAGTGCTGGAAGCCTGCCCGGAAGTCCACGATCTGAAACT GGCGGCCCGCTTTACCACCCGCACGCCTGCCAACTGGAAGAACATTGTCGATAACTATCTCGAGTGCTATCACTGTGGTC CGGCGCATCCAGGTTTCTCCGACTCCGTACAGGTTGATCGTTACTGGCACACCATGCACGGTAACTGGACGCTGCAATAC GGTTTCGCCAAACCGTCCGAACAGTCGTTTAAATTTGAAGAGGGTACGGATGCGGCATTCCACGGTTTCTGGCTGTGGCC GTGCACGATGCTGAACGTCACCCCGATCAAAGGGATGATGACGGTCATTTATGAATTCCCGGTGGATTCTGAAACTACCC TGCAAAACTACGATATTTACTTCACCAATGAAGAGTTAACCGACGAGCAAAAATCGCTGATTGAGTGGTATCGCGATGTG TTCCGTCCGGAAGATTTACGTCTGGTTGAAAGCGTACAGAAAGGGCTGAAATCGCGTGGCTATCGTGGTCAGGGGCGCAT CATGGCCGACAGTAGCGGTAGTGGCATTTCCGAACATGGTATCGCCCATTTCCATAATCTGCTGGCGCAGGTGTTTAAGG ACTAA
Upstream 100 bases:
>100_bases ACACCGGTTGAAGCCCTGGAAAAAACGCCAGTGCTCCCTGCGGGAACCGTATTCAAAGGCGACAACTGAGCGCCATCATC CTAACGATAAAGGTATCCCT
Downstream 100 bases:
>100_bases TGACATCGGCGGCGGTATTTTCCGCCGCTGGGCTGATTTTTGATGGAGTACAGCAATGTCAGACTATCAAATGTTTGAAG TACAGGTGAGCCAGGTTGAA
Product: Rieske (2Fe-2S) domain-containing protein
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 374; Mature: 373
Protein sequence:
>374_residues MSNLSPDFVLPENFCANPQEAWTIPARFYTDQNAFEHEKENVFAKSWICVAHSSELANANDYVTREIIGESIVLVRGRDK VLRAFYNVCPHRGHQLLSGEGKAKNVITCPYHAWAFKLDGNLAHARNCENVANFDSDKAQLVPVRLEEYAGFVFINMDPN ATSVEDQLPGLGAKVLEACPEVHDLKLAARFTTRTPANWKNIVDNYLECYHCGPAHPGFSDSVQVDRYWHTMHGNWTLQY GFAKPSEQSFKFEEGTDAAFHGFWLWPCTMLNVTPIKGMMTVIYEFPVDSETTLQNYDIYFTNEELTDEQKSLIEWYRDV FRPEDLRLVESVQKGLKSRGYRGQGRIMADSSGSGISEHGIAHFHNLLAQVFKD
Sequences:
>Translated_374_residues MSNLSPDFVLPENFCANPQEAWTIPARFYTDQNAFEHEKENVFAKSWICVAHSSELANANDYVTREIIGESIVLVRGRDK VLRAFYNVCPHRGHQLLSGEGKAKNVITCPYHAWAFKLDGNLAHARNCENVANFDSDKAQLVPVRLEEYAGFVFINMDPN ATSVEDQLPGLGAKVLEACPEVHDLKLAARFTTRTPANWKNIVDNYLECYHCGPAHPGFSDSVQVDRYWHTMHGNWTLQY GFAKPSEQSFKFEEGTDAAFHGFWLWPCTMLNVTPIKGMMTVIYEFPVDSETTLQNYDIYFTNEELTDEQKSLIEWYRDV FRPEDLRLVESVQKGLKSRGYRGQGRIMADSSGSGISEHGIAHFHNLLAQVFKD >Mature_373_residues SNLSPDFVLPENFCANPQEAWTIPARFYTDQNAFEHEKENVFAKSWICVAHSSELANANDYVTREIIGESIVLVRGRDKV LRAFYNVCPHRGHQLLSGEGKAKNVITCPYHAWAFKLDGNLAHARNCENVANFDSDKAQLVPVRLEEYAGFVFINMDPNA TSVEDQLPGLGAKVLEACPEVHDLKLAARFTTRTPANWKNIVDNYLECYHCGPAHPGFSDSVQVDRYWHTMHGNWTLQYG FAKPSEQSFKFEEGTDAAFHGFWLWPCTMLNVTPIKGMMTVIYEFPVDSETTLQNYDIYFTNEELTDEQKSLIEWYRDVF RPEDLRLVESVQKGLKSRGYRGQGRIMADSSGSGISEHGIAHFHNLLAQVFKD
Specific function: Unknown
COG id: COG4638
COG function: function code PR; Phenylpropionate dioxygenase and related ring-hydroxylating dioxygenases, large terminal subunit
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 1 Rieske domain
Homologues:
Organism=Escherichia coli, GI1788103, Length=374, Percent_Identity=100, Blast_Score=790, Evalue=0.0, Organism=Escherichia coli, GI1788888, Length=154, Percent_Identity=27.9220779220779, Blast_Score=81, Evalue=1e-16,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): YEAW_ECO57 (P0ABR8)
Other databases:
- EMBL: AE005174 - EMBL: BA000007 - PIR: C85791 - PIR: G90942 - RefSeq: NP_288238.1 - RefSeq: NP_310538.1 - ProteinModelPortal: P0ABR8 - SMR: P0ABR8 - EnsemblBacteria: EBESCT00000026914 - EnsemblBacteria: EBESCT00000060442 - GeneID: 912476 - GeneID: 961775 - GenomeReviews: AE005174_GR - GenomeReviews: BA000007_GR - KEGG: ece:Z2845 - KEGG: ecs:ECs2511 - GeneTree: EBGT00050000010714 - HOGENOM: HBG613280 - OMA: VCRHRAG - ProtClustDB: CLSK880211 - BioCyc: ECOL83334:ECS2511-MONOMER - InterPro: IPR017941 - InterPro: IPR015881 - InterPro: IPR001663 - Gene3D: G3DSA:2.102.10.10 - PANTHER: PTHR21266:SF2 - PRINTS: PR00090
Pfam domain/function: PF00355 Rieske; SSF50022 Rieske_dom
EC number: 1.14.1.- [C]
Molecular weight: Translated: 42561; Mature: 42430
Theoretical pI: Translated: 5.53; Mature: 5.53
Prosite motif: PS51296 RIESKE; PS00570 RING_HYDROXYL_ALPHA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
2.4 %Cys (Translated Protein) 1.9 %Met (Translated Protein) 4.3 %Cys+Met (Translated Protein) 2.4 %Cys (Mature Protein) 1.6 %Met (Mature Protein) 4.0 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MSNLSPDFVLPENFCANPQEAWTIPARFYTDQNAFEHEKENVFAKSWICVAHSSELANAN CCCCCCCEECCCHHCCCCHHHEECCCEEECCCCHHHHHHHHHHHHEEEEEECCCCCCCCC DYVTREIIGESIVLVRGRDKVLRAFYNVCPHRGHQLLSGEGKAKNVITCPYHAWAFKLDG HHHHHHHCCCEEEEEECHHHHHHHHHHHCCCCCCEECCCCCCCCCEEECCCEEEEEEECC NLAHARNCENVANFDSDKAQLVPVRLEEYAGFVFINMDPNATSVEDQLPGLGAKVLEACP CCHHHCCCCHHHCCCCCCCEEEEEEEHHHCCEEEEEECCCCCCHHHHCCCCCHHHHHHCC EVHDLKLAARFTTRTPANWKNIVDNYLECYHCGPAHPGFSDSVQVDRYWHTMHGNWTLQY CHHHEEEEEEECCCCCCCHHHHHHHHHHHHCCCCCCCCCCCCEEEEEEEEEECCCEEEEE GFAKPSEQSFKFEEGTDAAFHGFWLWPCTMLNVTPIKGMMTVIYEFPVDSETTLQNYDIY CCCCCCCCCCCCCCCCCCEECCEEEEEEEEEECCCHHHHEEEEEECCCCCCCEEEEEEEE FTNEELTDEQKSLIEWYRDVFRPEDLRLVESVQKGLKSRGYRGQGRIMADSSGSGISEHG ECCCHHCHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHCCCCCCCCEEECCCCCCCHHHH IAHFHNLLAQVFKD HHHHHHHHHHHHCC >Mature Secondary Structure SNLSPDFVLPENFCANPQEAWTIPARFYTDQNAFEHEKENVFAKSWICVAHSSELANAN CCCCCCEECCCHHCCCCHHHEECCCEEECCCCHHHHHHHHHHHHEEEEEECCCCCCCCC DYVTREIIGESIVLVRGRDKVLRAFYNVCPHRGHQLLSGEGKAKNVITCPYHAWAFKLDG HHHHHHHCCCEEEEEECHHHHHHHHHHHCCCCCCEECCCCCCCCCEEECCCEEEEEEECC NLAHARNCENVANFDSDKAQLVPVRLEEYAGFVFINMDPNATSVEDQLPGLGAKVLEACP CCHHHCCCCHHHCCCCCCCEEEEEEEHHHCCEEEEEECCCCCCHHHHCCCCCHHHHHHCC EVHDLKLAARFTTRTPANWKNIVDNYLECYHCGPAHPGFSDSVQVDRYWHTMHGNWTLQY CHHHEEEEEEECCCCCCCHHHHHHHHHHHHCCCCCCCCCCCCEEEEEEEEEECCCEEEEE GFAKPSEQSFKFEEGTDAAFHGFWLWPCTMLNVTPIKGMMTVIYEFPVDSETTLQNYDIY CCCCCCCCCCCCCCCCCCEECCEEEEEEEEEECCCHHHHEEEEEECCCCCCCEEEEEEEE FTNEELTDEQKSLIEWYRDVFRPEDLRLVESVQKGLKSRGYRGQGRIMADSSGSGISEHG ECCCHHCHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHCCCCCCCCEEECCCCCCCHHHH IAHFHNLLAQVFKD HHHHHHHHHHHHCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 11206551; 11258796