| Definition | Escherichia coli O157:H7 str. EC4115, complete genome. |
|---|---|
| Accession | NC_011353 |
| Length | 5,572,075 |
Click here to switch to the map view.
The map label for this gene is dcuS
Identifier: 209397333
GI number: 209397333
Start: 5279681
End: 5281312
Strand: Reverse
Name: dcuS
Synonym: ECH74115_5639
Alternate gene names: 209397333
Gene position: 5281312-5279681 (Counterclockwise)
Preceding gene: 209400647
Following gene: 209398643
Centisome position: 94.78
GC content: 50.25
Gene sequence:
>1632_bases ATGAGACATTCATTGCCCTACCGCATGTTACGCAAACGTCCGATGAAATTGAGTACCACAGTGATCTTAATGGTCAGCGC GGTACTGTTCTCGGTGCTATTGGTGGTGCATCTGATTTACTTCTCGCAAATCAGTGATATGACGCGAGACGGGCTAGCCA ACAAGGCACTGGCAGTGGCGCGTACTCTCGCCGACTCGCCGGAAATCCGTCAGGGCTTGCAGAAAAAACCGCAGGAGAGC GGCATCCAGGCCATCGCGGAAGCCGTGCGCAAACGCAACGATCTGCTGTTTATTGTCGTTACCGATATGCAAAGTCTTCG CTACTCGCATCCTGAAGCCCAGCGTATTGGTCAGCCATTTAAAGGTGATGACATCCTTAAAGCGCTGAATGGCGAAGAAA ATGTCGCTATCAATCGCGGTTTTCTGGCGCAGGCTTTACGCGTATTTACCCCCATCTACGATGAAAATCATAAACAAATT GGCGTGGTGGCGATCGGCCTTGAGTTAAGCCGCGTGACCCAACAGATCAATGACAGTCGCTGGAGCATTATCTGGTCGGT ATTATTTGGCATGCTGGTCGGACTGATTGGCACCTGCATTCTGGTTAAGGTACTGAAAAAAATCCTTTTCGGCCTGGAAC CCTACGAAATCTCCACGCTGTTTGAGCAACGCCAGGCCATGTTGCAGTCTATCAAAGAAGGCGTCGTTGCCGTGGACGAT CGCGGCGAGGTCACGCTGATCAACGATGCCGCACAAGAATTGCTGAATTACCGTAAGTCGCAGGACGATGAGAAACTGTC GACGCTCAGCCACTCATGGTCACAGGTGGTAGATGTCTCGGAAGTGTTACGCGACGGTACGCCGCGCCGCGACGAAGAGA TTACGATTAAAGACCGGCTATTACTGATCAACACCGTTCCGGTGCGCAGTAATGGCGTTATCATCGGTGCCATTTCAACC TTCAGGGACAAAACTGAAGTTCGTAAACTGATGCAGCGACTCGACGGTCTGGTCAACTATGCTGATGCACTTCGTGAACG ATCCCACGAATTTATGAATAAATTGCATGTGATTCTCGGATTATTGCATCTGAAGAGTTATAAGCAGTTGGAAGATTACA TTCTCAAAACAGCCAATAACTATCAGGAAGAGATTGGCTCTCTGCTGGGTAAGATCAAATCTCCGGTTATCGCTGGTTTT TTAATCAGCAAGATTAACCGCGCGACCGATTTAGGCCATACGCTGATTTTAAACAGTGAAAGCCAGCTGCCAGACAGCGG CAGTGAGGACCAGGTCGCGACGCTGATTACCACATTGGGAAATCTGATAGAAAACGCGCTGGAAGCATTAGGGCCGGAAC CCGGTGGCGAAATTAGCGTAACATTGCACTACCGTCACGGCTGGCTGCACTGCGAAGTTAACGATGATGGACCGGGGATC GCACCCGACAAAATCGATCACATTTTTGACAAAGGTGTCTCGACAAAAGGAAGCGAGCGAGGCGTCGGTTTAGCACTTGT CAAACAACAGGTAGAAAATCTCGGCGGCAGCATCGCCGTGGAATCGGAACCCGGGATTTTCACACAATTTTTTGTCCAGA TACCCTGGGACGGGGAGAGGTCGAACAGATGA
Upstream 100 bases:
>100_bases CCAGAGTCTCTTCCCCTATATAGCCAATCATTCTTACTCCCTTTGAATTACCCGCCTCATCAGAGATAATGCTTAAGAAA TTTGTCACACAAGGAAGCTG
Downstream 100 bases:
>100_bases TCAATGTATTAATTATCGATGACGACGCAATGGTCGCGGAGCTGAATCGCCGATACGTAGCACAAATCCCAGGCTTTCAA TGCTGTGGAACAGCCTCGAC
Product: sensory histidine kinase DcuS
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 543; Mature: 543
Protein sequence:
>543_residues MRHSLPYRMLRKRPMKLSTTVILMVSAVLFSVLLVVHLIYFSQISDMTRDGLANKALAVARTLADSPEIRQGLQKKPQES GIQAIAEAVRKRNDLLFIVVTDMQSLRYSHPEAQRIGQPFKGDDILKALNGEENVAINRGFLAQALRVFTPIYDENHKQI GVVAIGLELSRVTQQINDSRWSIIWSVLFGMLVGLIGTCILVKVLKKILFGLEPYEISTLFEQRQAMLQSIKEGVVAVDD RGEVTLINDAAQELLNYRKSQDDEKLSTLSHSWSQVVDVSEVLRDGTPRRDEEITIKDRLLLINTVPVRSNGVIIGAIST FRDKTEVRKLMQRLDGLVNYADALRERSHEFMNKLHVILGLLHLKSYKQLEDYILKTANNYQEEIGSLLGKIKSPVIAGF LISKINRATDLGHTLILNSESQLPDSGSEDQVATLITTLGNLIENALEALGPEPGGEISVTLHYRHGWLHCEVNDDGPGI APDKIDHIFDKGVSTKGSERGVGLALVKQQVENLGGSIAVESEPGIFTQFFVQIPWDGERSNR
Sequences:
>Translated_543_residues MRHSLPYRMLRKRPMKLSTTVILMVSAVLFSVLLVVHLIYFSQISDMTRDGLANKALAVARTLADSPEIRQGLQKKPQES GIQAIAEAVRKRNDLLFIVVTDMQSLRYSHPEAQRIGQPFKGDDILKALNGEENVAINRGFLAQALRVFTPIYDENHKQI GVVAIGLELSRVTQQINDSRWSIIWSVLFGMLVGLIGTCILVKVLKKILFGLEPYEISTLFEQRQAMLQSIKEGVVAVDD RGEVTLINDAAQELLNYRKSQDDEKLSTLSHSWSQVVDVSEVLRDGTPRRDEEITIKDRLLLINTVPVRSNGVIIGAIST FRDKTEVRKLMQRLDGLVNYADALRERSHEFMNKLHVILGLLHLKSYKQLEDYILKTANNYQEEIGSLLGKIKSPVIAGF LISKINRATDLGHTLILNSESQLPDSGSEDQVATLITTLGNLIENALEALGPEPGGEISVTLHYRHGWLHCEVNDDGPGI APDKIDHIFDKGVSTKGSERGVGLALVKQQVENLGGSIAVESEPGIFTQFFVQIPWDGERSNR >Mature_543_residues MRHSLPYRMLRKRPMKLSTTVILMVSAVLFSVLLVVHLIYFSQISDMTRDGLANKALAVARTLADSPEIRQGLQKKPQES GIQAIAEAVRKRNDLLFIVVTDMQSLRYSHPEAQRIGQPFKGDDILKALNGEENVAINRGFLAQALRVFTPIYDENHKQI GVVAIGLELSRVTQQINDSRWSIIWSVLFGMLVGLIGTCILVKVLKKILFGLEPYEISTLFEQRQAMLQSIKEGVVAVDD RGEVTLINDAAQELLNYRKSQDDEKLSTLSHSWSQVVDVSEVLRDGTPRRDEEITIKDRLLLINTVPVRSNGVIIGAIST FRDKTEVRKLMQRLDGLVNYADALRERSHEFMNKLHVILGLLHLKSYKQLEDYILKTANNYQEEIGSLLGKIKSPVIAGF LISKINRATDLGHTLILNSESQLPDSGSEDQVATLITTLGNLIENALEALGPEPGGEISVTLHYRHGWLHCEVNDDGPGI APDKIDHIFDKGVSTKGSERGVGLALVKQQVENLGGSIAVESEPGIFTQFFVQIPWDGERSNR
Specific function: Member of the two-component regulatory system dcuR/dcuS. Involved in the C4-dicarboxylate-stimulated regulation of the genes encoding the anaerobic fumarate respiratory system (frdABCD; nuoAN; dcuB; dcuC; sdhCDAB; etc.). Weakly regulates the aerobic C4-di
COG id: COG3290
COG function: function code T; Signal transduction histidine kinase regulating citrate/malate metabolism
Gene ontology:
Cell location: Cell inner membrane; Multi-pass membrane protein
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 1 PAS (PER-ARNT-SIM) domain
Homologues:
Organism=Escherichia coli, GI1790567, Length=543, Percent_Identity=100, Blast_Score=1104, Evalue=0.0, Organism=Escherichia coli, GI1786837, Length=542, Percent_Identity=27.4907749077491, Blast_Score=187, Evalue=2e-48, Organism=Escherichia coli, GI1790300, Length=346, Percent_Identity=26.878612716763, Blast_Score=69, Evalue=6e-13, Organism=Escherichia coli, GI1790436, Length=235, Percent_Identity=30.2127659574468, Blast_Score=67, Evalue=3e-12, Organism=Escherichia coli, GI1788549, Length=349, Percent_Identity=23.7822349570201, Blast_Score=66, Evalue=6e-12, Organism=Escherichia coli, GI1786600, Length=352, Percent_Identity=24.4318181818182, Blast_Score=63, Evalue=6e-11,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): DCUS_ECO57 (P0AEC9)
Other databases:
- EMBL: AE005174 - EMBL: BA000007 - PIR: C91267 - PIR: H86107 - RefSeq: NP_290758.1 - RefSeq: NP_313134.1 - ProteinModelPortal: P0AEC9 - EnsemblBacteria: EBESCT00000026461 - EnsemblBacteria: EBESCT00000057843 - GeneID: 914212 - GeneID: 959999 - GenomeReviews: AE005174_GR - GenomeReviews: BA000007_GR - KEGG: ece:Z5727 - KEGG: ecs:ECs5107 - GeneTree: EBGT00050000008665 - HOGENOM: HBG537380 - OMA: TMLQSVK - ProtClustDB: PRK11086 - BioCyc: ECOL83334:ECS5107-MONOMER - InterPro: IPR003594 - InterPro: IPR000014 - InterPro: IPR013767 - InterPro: IPR004358 - InterPro: IPR016120 - InterPro: IPR005467 - InterPro: IPR016121 - Gene3D: G3DSA:3.30.565.10 - Gene3D: G3DSA:1.10.287.130 - PRINTS: PR00344 - SMART: SM00387 - SMART: SM00091 - TIGRFAMs: TIGR00229
Pfam domain/function: PF02518 HATPase_c; PF00989 PAS; SSF55874 ATP_bd_ATPase; SSF55890 Sensor_kinase_SpoOB-type
EC number: =2.7.13.3
Molecular weight: Translated: 60552; Mature: 60552
Theoretical pI: Translated: 6.72; Mature: 6.72
Prosite motif: PS50109 HIS_KIN; PS50112 PAS
Important sites: NA
Signals:
None
Transmembrane regions:
HASH(0x109b96d0)-; HASH(0x137bebb4)-;
Cys/Met content:
0.4 %Cys (Translated Protein) 1.8 %Met (Translated Protein) 2.2 %Cys+Met (Translated Protein) 0.4 %Cys (Mature Protein) 1.8 %Met (Mature Protein) 2.2 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MRHSLPYRMLRKRPMKLSTTVILMVSAVLFSVLLVVHLIYFSQISDMTRDGLANKALAVA CCCCCCHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH RTLADSPEIRQGLQKKPQESGIQAIAEAVRKRNDLLFIVVTDMQSLRYSHPEAQRIGQPF HHHCCCHHHHHHHHCCCHHHHHHHHHHHHHCCCCEEEEEECCHHHHHCCCCCHHHCCCCC KGDDILKALNGEENVAINRGFLAQALRVFTPIYDENHKQIGVVAIGLELSRVTQQINDSR CCCHHHHHHCCCCCEEECHHHHHHHHHHHCCHHCCCCCEEEEEEECHHHHHHHHHHCCHH WSIIWSVLFGMLVGLIGTCILVKVLKKILFGLEPYEISTLFEQRQAMLQSIKEGVVAVDD HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHCCCEEECC RGEVTLINDAAQELLNYRKSQDDEKLSTLSHSWSQVVDVSEVLRDGTPRRDEEITIKDRL CCCEEEEHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCEEEEECEE LLINTVPVRSNGVIIGAISTFRDKTEVRKLMQRLDGLVNYADALRERSHEFMNKLHVILG EEEEECCCCCCCEEEEEHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH LLHLKSYKQLEDYILKTANNYQEEIGSLLGKIKSPVIAGFLISKINRATDLGHTLILNSE HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCEEEECCC SQLPDSGSEDQVATLITTLGNLIENALEALGPEPGGEISVTLHYRHGWLHCEVNDDGPGI CCCCCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCEEEEEEEEECCEEEEEECCCCCCC APDKIDHIFDKGVSTKGSERGVGLALVKQQVENLGGSIAVESEPGIFTQFFVQIPWDGER CHHHHHHHHHCCCCCCCCCCCCHHHHHHHHHHHCCCEEEEECCCCCEEEEEEECCCCCCC SNR CCH >Mature Secondary Structure MRHSLPYRMLRKRPMKLSTTVILMVSAVLFSVLLVVHLIYFSQISDMTRDGLANKALAVA CCCCCCHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH RTLADSPEIRQGLQKKPQESGIQAIAEAVRKRNDLLFIVVTDMQSLRYSHPEAQRIGQPF HHHCCCHHHHHHHHCCCHHHHHHHHHHHHHCCCCEEEEEECCHHHHHCCCCCHHHCCCCC KGDDILKALNGEENVAINRGFLAQALRVFTPIYDENHKQIGVVAIGLELSRVTQQINDSR CCCHHHHHHCCCCCEEECHHHHHHHHHHHCCHHCCCCCEEEEEEECHHHHHHHHHHCCHH WSIIWSVLFGMLVGLIGTCILVKVLKKILFGLEPYEISTLFEQRQAMLQSIKEGVVAVDD HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHCCCEEECC RGEVTLINDAAQELLNYRKSQDDEKLSTLSHSWSQVVDVSEVLRDGTPRRDEEITIKDRL CCCEEEEHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCEEEEECEE LLINTVPVRSNGVIIGAISTFRDKTEVRKLMQRLDGLVNYADALRERSHEFMNKLHVILG EEEEECCCCCCCEEEEEHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH LLHLKSYKQLEDYILKTANNYQEEIGSLLGKIKSPVIAGFLISKINRATDLGHTLILNSE HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCEEEECCC SQLPDSGSEDQVATLITTLGNLIENALEALGPEPGGEISVTLHYRHGWLHCEVNDDGPGI CCCCCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCEEEEEEEEECCEEEEEECCCCCCC APDKIDHIFDKGVSTKGSERGVGLALVKQQVENLGGSIAVESEPGIFTQFFVQIPWDGER CHHHHHHHHHCCCCCCCCCCCCHHHHHHHHHHHCCCEEEEECCCCCEEEEEEECCCCCCC SNR CCH
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 6.0
TargetDB status: NA
Availability: NA
References: 11206551; 11258796