The gene/protein map for NC_011745 is currently unavailable.
Definition Escherichia coli ED1a chromosome, complete genome.
Accession NC_011745
Length 5,209,548

Click here to switch to the map view.

The map label for this gene is dos [H]

Identifier: 218689402

GI number: 218689402

Start: 1617355

End: 1619754

Strand: Reverse

Name: dos [H]

Synonym: ECED1_1635

Alternate gene names: 218689402

Gene position: 1619754-1617355 (Counterclockwise)

Preceding gene: 218689403

Following gene: 218689400

Centisome position: 31.09

GC content: 49.79

Gene sequence:

>2400_bases
ATGAAGCTAACCGATGCGGATAATGCTGCCGATGGCATTTTTTTCCCCGCCCTTGAGCAAAATATGATGGGCGCGGTGTT
AATTAACGAAAATGATGAAGTGATGTTTTTCAACCCCGCCGCAGAGAAGCTCTGGGGGTACAAACGTGAAGAAGTCATTG
GCAATAACATTGATATGCTGATTCCGCGGGATTTGCGTCCTGCGCATCCTCAATACATTCGTCACAACCGTGAAGGTGGT
AAAGCGCGCGTCGAGGGGATGAGTCGGGAGCTGCAGCTGGAGAAAAAAGACGGCAGTAAAATCTGGACCCGTTTTGCGCT
ATCGAAAGTGAGCGCCGAGGGGAAAGTTTATTACCTGGCGCTGGTACGGGATGCCAGCGTAGAAATGGCGCAAAAAGAAC
AGACCCGACAATTGATTATTGCCGTTGACCATCTCGACCGACCGGTGATTGTCCTCGATCCGGAACGCCATATTGTGCAG
TGCAATCGCGCATTTACCGAAATGTTTGGTTACTGCATTAACGAAGCCAGCGGTATGCAGCCCGATACACTCCTGAACAT
TCCAGAATTCCCTGCTGATAACCGTATTCGTTTACAACAGTTGCTATGGAAAACCGCCCGCGATCAGGACGAATTTCTGC
TGTTGACGCGCACCGGTGAAAAAATCTGGATTAAAGCCTCTATCAGCCCGGTTTATGACGTGCTCGCGCATCTGCAGAAC
CTGGTAATGACATTCTCGGATATCACCGAAGAAAGGCAAATCCGCCAGCTTGAAGGCAATATTCTCGCCGCCATGTGCAG
CAGCCCCCCATTTCATGAAATGGGGGAAATCATTTGTCGTAACATCGAATCTGTTCTCAACGAATCGCATGTTTCGCTGT
TCGCGCTGCGCAACGGGATGCCGATACACTGGGCGTCATCTTCGCACGGTGCAGAAGTTCAAAATGCGCAAAGCTGGTCA
GCGACCATTCGTCAGCGCGATGGCGCGCCTGCGGGGATCCTGCAAATTAAAACCTCGTCAGGAGCAGAAACCAGCGCCTT
TATCGAACGCGTGGCAGATATCAGCCAGCATATGGCCGCGCTGGCGCTGGAACAGGAAAAAAGCCGTCAGCATATTGAAC
AACTCATCCAATTTGATCCGATGACCGGTCTGCCAAATCGCAATAACCTGCACAATTACCTCGATGACCTGGTCGACAAA
GCCGTCTCTCCGGTGGTGTATCTCATCGGTGTTGACCATATTCAGGATGTGATTGATAGCCTTGGCTATGCGTGGGCCGA
TCAGGCATTGCTGGAAGTGGTCAATCGCTTTCGTGAAAAACTCAAACCGGATCAGTATCTCTGTCGTATTGAAGGTGCGT
CTTTTGTCCTCGTGAGCCTGGAAAACGATGTCAGTAACATTACCCAGATCGCCGATGAGCTACGGAATGTGGTCAGCAAG
CCGATAATGATTGACGATAAACCATTCCCGCTCACCTTGAGCATTGGCATCAGCTACGACGAGGGTAAAAACCGCGATTA
CTTGCTCTCCACTGCTCACAATGCAATGGATTTTATTCGCAAAAATGGCGGTAACGGCTGGCAGTTCTTCAGCCCGGCGA
TGAACGAAATGGTAAAAGAGCGTTTGGTTTTAGGCGCAGCGCTAAAAGAAGCGATTAGCAATAACCAACTTAAACTGGTT
TATCAGCCGCAAATCTTCGCAGAAACGGGTGAACTGTACGGCATCGAAGCCCTTGCTCGCTGGTACGATCCCCTGCATGG
TCATGTGCCCCCTTCACGGTTTATTCCTCTCGCAGAAGAGATTGGTGAAATCGAAAATATTGGGCGCTGGGTCATCTCGG
AAGCTTGCCGTCAGTTAGCAGAATGGCGTAGCCAGAATATTCATATCCCGGCGTTATCCGTTAACTTGTCTGCGCTGCAC
TTTCGCAGTAATCAGCTGCCTAATCAGGTATCTGATGCAATGCACGCCTGGGGTATTGACGGCCACCAGCTGACGGTGGA
AATCACGGAAAGCATGATGATGGAACACGATACCGAAATCTTTAAGCGCATTCAGATCCTGCGCGATATGGGCATCGGTT
TATCGGTAGATGATTTTGGTACAGGCTTTTCCGGATTATCCCGCTTAGTCAGTCTTCCTGTAACGGAAATCAAAATTGAT
AAAAGTTTTGTCGATCGTTGTCTGACCGAAAAACGCATCCTTGCCTTACTCGAAGCCATTACCAGCATTGGGCAAAGCCT
CAATTTAACCGTCGTGGCTGAAGGCATCGAAACCAAAGAGCAATTTGAGATGCTACGCAAGATCCACTGTCGCGTTATTC
AGGGATATTTCTTTTCCCGCCCCCTGCCCGCCGAAGAAATTCCAGGCTGGATGAGCAGCGTGTTACCGCTGAAAATCTGA

Upstream 100 bases:

>100_bases
AATAGCCGATGAAGCTCTGTATATCGCCAAAAGACGAGGTAGAAACCGTGTTGAACTCTGTAAAGCCAGTCTTTAGATGC
GCCAGGATGCAGAGGTAATC

Downstream 100 bases:

>100_bases
CAAATTCCTCTCGCCCGCACTCGCGGGTTTTTATTTAACGTGACACTGTCACTTAAATACTGTGATTTCCGCTACGTTTA
GTTGGACAACGACAACGCAT

Product: cAMP phosphodiesterase

Products: NA

Alternate protein names: Direct oxygen sensing phosphodiesterase; Direct oxygen sensor protein; Ec DOS; Heme-regulated cyclic di-GMP phosphodiesterase, [H]

Number of amino acids: Translated: 799; Mature: 799

Protein sequence:

>799_residues
MKLTDADNAADGIFFPALEQNMMGAVLINENDEVMFFNPAAEKLWGYKREEVIGNNIDMLIPRDLRPAHPQYIRHNREGG
KARVEGMSRELQLEKKDGSKIWTRFALSKVSAEGKVYYLALVRDASVEMAQKEQTRQLIIAVDHLDRPVIVLDPERHIVQ
CNRAFTEMFGYCINEASGMQPDTLLNIPEFPADNRIRLQQLLWKTARDQDEFLLLTRTGEKIWIKASISPVYDVLAHLQN
LVMTFSDITEERQIRQLEGNILAAMCSSPPFHEMGEIICRNIESVLNESHVSLFALRNGMPIHWASSSHGAEVQNAQSWS
ATIRQRDGAPAGILQIKTSSGAETSAFIERVADISQHMAALALEQEKSRQHIEQLIQFDPMTGLPNRNNLHNYLDDLVDK
AVSPVVYLIGVDHIQDVIDSLGYAWADQALLEVVNRFREKLKPDQYLCRIEGASFVLVSLENDVSNITQIADELRNVVSK
PIMIDDKPFPLTLSIGISYDEGKNRDYLLSTAHNAMDFIRKNGGNGWQFFSPAMNEMVKERLVLGAALKEAISNNQLKLV
YQPQIFAETGELYGIEALARWYDPLHGHVPPSRFIPLAEEIGEIENIGRWVISEACRQLAEWRSQNIHIPALSVNLSALH
FRSNQLPNQVSDAMHAWGIDGHQLTVEITESMMMEHDTEIFKRIQILRDMGIGLSVDDFGTGFSGLSRLVSLPVTEIKID
KSFVDRCLTEKRILALLEAITSIGQSLNLTVVAEGIETKEQFEMLRKIHCRVIQGYFFSRPLPAEEIPGWMSSVLPLKI

Sequences:

>Translated_799_residues
MKLTDADNAADGIFFPALEQNMMGAVLINENDEVMFFNPAAEKLWGYKREEVIGNNIDMLIPRDLRPAHPQYIRHNREGG
KARVEGMSRELQLEKKDGSKIWTRFALSKVSAEGKVYYLALVRDASVEMAQKEQTRQLIIAVDHLDRPVIVLDPERHIVQ
CNRAFTEMFGYCINEASGMQPDTLLNIPEFPADNRIRLQQLLWKTARDQDEFLLLTRTGEKIWIKASISPVYDVLAHLQN
LVMTFSDITEERQIRQLEGNILAAMCSSPPFHEMGEIICRNIESVLNESHVSLFALRNGMPIHWASSSHGAEVQNAQSWS
ATIRQRDGAPAGILQIKTSSGAETSAFIERVADISQHMAALALEQEKSRQHIEQLIQFDPMTGLPNRNNLHNYLDDLVDK
AVSPVVYLIGVDHIQDVIDSLGYAWADQALLEVVNRFREKLKPDQYLCRIEGASFVLVSLENDVSNITQIADELRNVVSK
PIMIDDKPFPLTLSIGISYDEGKNRDYLLSTAHNAMDFIRKNGGNGWQFFSPAMNEMVKERLVLGAALKEAISNNQLKLV
YQPQIFAETGELYGIEALARWYDPLHGHVPPSRFIPLAEEIGEIENIGRWVISEACRQLAEWRSQNIHIPALSVNLSALH
FRSNQLPNQVSDAMHAWGIDGHQLTVEITESMMMEHDTEIFKRIQILRDMGIGLSVDDFGTGFSGLSRLVSLPVTEIKID
KSFVDRCLTEKRILALLEAITSIGQSLNLTVVAEGIETKEQFEMLRKIHCRVIQGYFFSRPLPAEEIPGWMSSVLPLKI
>Mature_799_residues
MKLTDADNAADGIFFPALEQNMMGAVLINENDEVMFFNPAAEKLWGYKREEVIGNNIDMLIPRDLRPAHPQYIRHNREGG
KARVEGMSRELQLEKKDGSKIWTRFALSKVSAEGKVYYLALVRDASVEMAQKEQTRQLIIAVDHLDRPVIVLDPERHIVQ
CNRAFTEMFGYCINEASGMQPDTLLNIPEFPADNRIRLQQLLWKTARDQDEFLLLTRTGEKIWIKASISPVYDVLAHLQN
LVMTFSDITEERQIRQLEGNILAAMCSSPPFHEMGEIICRNIESVLNESHVSLFALRNGMPIHWASSSHGAEVQNAQSWS
ATIRQRDGAPAGILQIKTSSGAETSAFIERVADISQHMAALALEQEKSRQHIEQLIQFDPMTGLPNRNNLHNYLDDLVDK
AVSPVVYLIGVDHIQDVIDSLGYAWADQALLEVVNRFREKLKPDQYLCRIEGASFVLVSLENDVSNITQIADELRNVVSK
PIMIDDKPFPLTLSIGISYDEGKNRDYLLSTAHNAMDFIRKNGGNGWQFFSPAMNEMVKERLVLGAALKEAISNNQLKLV
YQPQIFAETGELYGIEALARWYDPLHGHVPPSRFIPLAEEIGEIENIGRWVISEACRQLAEWRSQNIHIPALSVNLSALH
FRSNQLPNQVSDAMHAWGIDGHQLTVEITESMMMEHDTEIFKRIQILRDMGIGLSVDDFGTGFSGLSRLVSLPVTEIKID
KSFVDRCLTEKRILALLEAITSIGQSLNLTVVAEGIETKEQFEMLRKIHCRVIQGYFFSRPLPAEEIPGWMSSVLPLKI

Specific function: In association with DosC is involved in the production and removal of the second messenger c-di-GMP in response to changing O(2) levels. Has phosphodiesterase (PDE) activity with c- di-GMP (PubMed:15995192), very poor activity on cAMP (PubMed:15995192) bu

COG id: COG2202

COG function: function code T; FOG: PAS/PAC domain

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 2 PAS (PER-ARNT-SIM) domains [H]

Homologues:

Organism=Escherichia coli, GI87081921, Length=799, Percent_Identity=98.6232790988736, Blast_Score=1639, Evalue=0.0,
Organism=Escherichia coli, GI1787541, Length=439, Percent_Identity=33.4851936218679, Blast_Score=230, Evalue=2e-61,
Organism=Escherichia coli, GI226510982, Length=416, Percent_Identity=31.4903846153846, Blast_Score=186, Evalue=4e-48,
Organism=Escherichia coli, GI87081845, Length=238, Percent_Identity=34.453781512605, Blast_Score=148, Evalue=1e-36,
Organism=Escherichia coli, GI1790496, Length=247, Percent_Identity=36.0323886639676, Blast_Score=148, Evalue=1e-36,
Organism=Escherichia coli, GI87081980, Length=261, Percent_Identity=32.183908045977, Blast_Score=133, Evalue=4e-32,
Organism=Escherichia coli, GI87081743, Length=245, Percent_Identity=34.2857142857143, Blast_Score=127, Evalue=3e-30,
Organism=Escherichia coli, GI1786507, Length=325, Percent_Identity=29.8461538461538, Blast_Score=125, Evalue=1e-29,
Organism=Escherichia coli, GI1788502, Length=255, Percent_Identity=29.0196078431373, Blast_Score=123, Evalue=5e-29,
Organism=Escherichia coli, GI1787055, Length=275, Percent_Identity=29.8181818181818, Blast_Score=121, Evalue=2e-28,
Organism=Escherichia coli, GI1788849, Length=462, Percent_Identity=25.3246753246753, Blast_Score=118, Evalue=1e-27,
Organism=Escherichia coli, GI87082096, Length=262, Percent_Identity=27.8625954198473, Blast_Score=95, Evalue=2e-20,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR001054
- InterPro:   IPR000160
- InterPro:   IPR001633
- InterPro:   IPR012226
- InterPro:   IPR001610
- InterPro:   IPR000014
- InterPro:   IPR000700
- InterPro:   IPR013656
- InterPro:   IPR013767 [H]

Pfam domain/function: PF00563 EAL; PF00990 GGDEF; PF00989 PAS; PF08448 PAS_4 [H]

EC number: =3.1.4.52 [H]

Molecular weight: Translated: 90273; Mature: 90273

Theoretical pI: Translated: 5.18; Mature: 5.18

Prosite motif: PS50112 PAS ; PS50113 PAC ; PS50883 EAL ; PS50887 GGDEF

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.0 %Cys     (Translated Protein)
3.3 %Met     (Translated Protein)
4.3 %Cys+Met (Translated Protein)
1.0 %Cys     (Mature Protein)
3.3 %Met     (Mature Protein)
4.3 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKLTDADNAADGIFFPALEQNMMGAVLINENDEVMFFNPAAEKLWGYKREEVIGNNIDML
CCCCCCCCCCCCCCCHHHHCCCCEEEEECCCCCEEEECCHHHHHCCCCHHHHCCCCCCEE
IPRDLRPAHPQYIRHNREGGKARVEGMSRELQLEKKDGSKIWTRFALSKVSAEGKVYYLA
ECCCCCCCCHHHHHCCCCCCHHHHHCCCHHEEEECCCCHHHHHHHHHHHHCCCCCEEEEE
LVRDASVEMAQKEQTRQLIIAVDHLDRPVIVLDPERHIVQCNRAFTEMFGYCINEASGMQ
EEECCHHHHHHHHHHHEEEEEEECCCCCEEEECCCHHHHHHHHHHHHHHHHHHHCCCCCC
PDTLLNIPEFPADNRIRLQQLLWKTARDQDEFLLLTRTGEKIWIKASISPVYDVLAHLQN
CCCEECCCCCCCCCHHHHHHHHHHHCCCCCCEEEEEECCCEEEEEECCCHHHHHHHHHHH
LVMTFSDITEERQIRQLEGNILAAMCSSPPFHEMGEIICRNIESVLNESHVSLFALRNGM
HHHHHHHHHHHHHHHHHCCCEEEEECCCCCHHHHHHHHHHHHHHHHCCCHHEEEEECCCC
PIHWASSSHGAEVQNAQSWSATIRQRDGAPAGILQIKTSSGAETSAFIERVADISQHMAA
EEEECCCCCCCCCCCCHHHHHHHHHCCCCCCCEEEEECCCCCHHHHHHHHHHHHHHHHHH
LALEQEKSRQHIEQLIQFDPMTGLPNRNNLHNYLDDLVDKAVSPVVYLIGVDHIQDVIDS
HHHHHHHHHHHHHHHHHCCCCCCCCCCCCHHHHHHHHHHHHHCCEEEEHHHHHHHHHHHH
LGYAWADQALLEVVNRFREKLKPDQYLCRIEGASFVLVSLENDVSNITQIADELRNVVSK
HCHHHHHHHHHHHHHHHHHHCCCCCEEEEECCCEEEEEEECCCHHHHHHHHHHHHHHHCC
PIMIDDKPFPLTLSIGISYDEGKNRDYLLSTAHNAMDFIRKNGGNGWQFFSPAMNEMVKE
CEEECCCCCCEEEEEEEEECCCCCCCEEEHHHHHHHHHHHHCCCCCCEECCHHHHHHHHH
RLVLGAALKEAISNNQLKLVYQPQIFAETGELYGIEALARWYDPLHGHVPPSRFIPLAEE
HHHHHHHHHHHHCCCCEEEEECCCCEECCCCHHHHHHHHHHHHHHCCCCCHHHCCCHHHH
IGEIENIGRWVISEACRQLAEWRSQNIHIPALSVNLSALHFRSNQLPNQVSDAMHAWGID
HHHHHHHHHHHHHHHHHHHHHHHHCCEEEEEEEEEHHEEEECCCCCCHHHHHHHHHCCCC
GHQLTVEITESMMMEHDTEIFKRIQILRDMGIGLSVDDFGTGFSGLSRLVSLPVTEIKID
CCEEEEEEHHHHHHHHHHHHHHHHHHHHHCCCCCEECCCCCCHHHHHHHHHCCCHHEEEC
KSFVDRCLTEKRILALLEAITSIGQSLNLTVVAEGIETKEQFEMLRKIHCRVIQGYFFSR
HHHHHHHHHHHHHHHHHHHHHHCCCCCEEEEEECCCCCHHHHHHHHHHHHHHHHHHHHCC
PLPAEEIPGWMSSVLPLKI
CCCHHHCCCHHHHCCCCCC
>Mature Secondary Structure
MKLTDADNAADGIFFPALEQNMMGAVLINENDEVMFFNPAAEKLWGYKREEVIGNNIDML
CCCCCCCCCCCCCCCHHHHCCCCEEEEECCCCCEEEECCHHHHHCCCCHHHHCCCCCCEE
IPRDLRPAHPQYIRHNREGGKARVEGMSRELQLEKKDGSKIWTRFALSKVSAEGKVYYLA
ECCCCCCCCHHHHHCCCCCCHHHHHCCCHHEEEECCCCHHHHHHHHHHHHCCCCCEEEEE
LVRDASVEMAQKEQTRQLIIAVDHLDRPVIVLDPERHIVQCNRAFTEMFGYCINEASGMQ
EEECCHHHHHHHHHHHEEEEEEECCCCCEEEECCCHHHHHHHHHHHHHHHHHHHCCCCCC
PDTLLNIPEFPADNRIRLQQLLWKTARDQDEFLLLTRTGEKIWIKASISPVYDVLAHLQN
CCCEECCCCCCCCCHHHHHHHHHHHCCCCCCEEEEEECCCEEEEEECCCHHHHHHHHHHH
LVMTFSDITEERQIRQLEGNILAAMCSSPPFHEMGEIICRNIESVLNESHVSLFALRNGM
HHHHHHHHHHHHHHHHHCCCEEEEECCCCCHHHHHHHHHHHHHHHHCCCHHEEEEECCCC
PIHWASSSHGAEVQNAQSWSATIRQRDGAPAGILQIKTSSGAETSAFIERVADISQHMAA
EEEECCCCCCCCCCCCHHHHHHHHHCCCCCCCEEEEECCCCCHHHHHHHHHHHHHHHHHH
LALEQEKSRQHIEQLIQFDPMTGLPNRNNLHNYLDDLVDKAVSPVVYLIGVDHIQDVIDS
HHHHHHHHHHHHHHHHHCCCCCCCCCCCCHHHHHHHHHHHHHCCEEEEHHHHHHHHHHHH
LGYAWADQALLEVVNRFREKLKPDQYLCRIEGASFVLVSLENDVSNITQIADELRNVVSK
HCHHHHHHHHHHHHHHHHHHCCCCCEEEEECCCEEEEEEECCCHHHHHHHHHHHHHHHCC
PIMIDDKPFPLTLSIGISYDEGKNRDYLLSTAHNAMDFIRKNGGNGWQFFSPAMNEMVKE
CEEECCCCCCEEEEEEEEECCCCCCCEEEHHHHHHHHHHHHCCCCCCEECCHHHHHHHHH
RLVLGAALKEAISNNQLKLVYQPQIFAETGELYGIEALARWYDPLHGHVPPSRFIPLAEE
HHHHHHHHHHHHCCCCEEEEECCCCEECCCCHHHHHHHHHHHHHHCCCCCHHHCCCHHHH
IGEIENIGRWVISEACRQLAEWRSQNIHIPALSVNLSALHFRSNQLPNQVSDAMHAWGID
HHHHHHHHHHHHHHHHHHHHHHHHCCEEEEEEEEEHHEEEECCCCCCHHHHHHHHHCCCC
GHQLTVEITESMMMEHDTEIFKRIQILRDMGIGLSVDDFGTGFSGLSRLVSLPVTEIKID
CCEEEEEEHHHHHHHHHHHHHHHHHHHHHCCCCCEECCCCCCHHHHHHHHHCCCHHEEEC
KSFVDRCLTEKRILALLEAITSIGQSLNLTVVAEGIETKEQFEMLRKIHCRVIQGYFFSR
HHHHHHHHHHHHHHHHHHHHHHCCCCCEEEEEECCCCCHHHHHHHHHHHHHHHHHHHHCC
PLPAEEIPGWMSSVLPLKI
CCCHHHCCCHHHHCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 9097039; 9278503 [H]