Definition Escherichia fergusonii ATCC 35469 chromosome, complete genome.
Accession NC_011740
Length 4,588,711

Click here to switch to the map view.

The map label for this gene is dos [H]

Identifier: 218548933

GI number: 218548933

Start: 1619866

End: 1622271

Strand: Direct

Name: dos [H]

Synonym: EFER_1580

Alternate gene names: 218548933

Gene position: 1619866-1622271 (Clockwise)

Preceding gene: 218548932

Following gene: 218548937

Centisome position: 35.3

GC content: 47.96

Gene sequence:

>2406_bases
ATGAAACTGACCGATGCAGAAAATAGTGATGACGGCATTTTCTTTCCCGCCCTTGAACAAAATATGATGGGCGCGGTGCT
GATCAATGAAAACGATGAGGTGCTGTTCTTTAACCCGGCGGCGGAAAAATTATGGGGATACACGCGGGAAGAAGTCATCG
GCAATAATATTTCCATGTTGATTCCCCAGGATTTGCGCCCTGCCCATCCTGATTACATTCGCCATAATCGTGAAGGTGGT
AAGCCTCGCGTTGAAGGAATGAGCCGTGAACTGCAACTGGAAAAAAAAGATGGCAGCAAAATCTGGACACGTTTCGCCCT
GTCAAAAGTGACTGCTGCCGGAAAAATCTTCTACCTGGCATTAGTCAGAGATGCCAGTGTCGAAGTGGCGCAAAAAGAGC
AGACACGCCTGCTGATTATCGCCGTTGACCATCTTGATCGTCCGGTGATCGTGCTCGATCCCGAGCGCCGTATAGTTCAG
TGCAATCGTGCATTCACCGAAATGTTCGGTCACTGTGTAAGCGAAGCTGCGGGTAAACAACCCGATGAGCTGCTTAATAT
ACCGGAACTCCCTTCCGACAATCGGTTACGGGTCAAACAATTACTCTGGAAATATGGCCGTGATCAGGATGAGTTTCTGA
TGCTAACTCGCGCCGGTGAGAAGATTTGGATCAAGGCCTCTATAAGCCCGGTATACGATAAAATGTCGGTGCTGCAAAAC
CTGGTGATGACCTTTTCTGATATCACCGAAGAACGGCAAATTCGCCAACTGGAAGGAAATATTCTTGCCGCTATGTGCAG
CAGTCCGCCGTTTCATGAAATGGGCGAGATTATTTGCCGCAATATTGAATCGATTCTACGAAATACCCACGTCTCACTCT
ATGCTTTGCGTAATAGCGTGCCGTTGCACTGGGCCTCGTCTTCCCGTGACATTGATACCACAAATGCTAAAGTCTGGTCT
CTAACCATTCGCCAGCGTGACGGTGCGCCAGCCGGAACACTCCTGATTAAAACCATTGCAGGTCAGGAAACCAGTGGATT
TATTGAGCGTGTAGCTGATATCAGCCAACACCTGGCAGCTCTGGCGCTGGAACAAGAAAAAAGCCGACAACATATTGAAC
AACTTATCCAGTTTGATCCGTTAACGGGATTGCCTAATCGCAATAACCTGCACAGTTATCTCGACGAACTGGTCGGCAAA
GATATTTCCCCTGTCGTTTATCTCATAAGTATTGATAACTTACAGGATGTGATCGACAGCCTTGGTTATGCCTGGGCCGA
TCAGGCGGTGCTCGAGGTAGTTCATCGTATCCGGGATAAACTCAAACCAGACCAGTATTTGTGCCGGGTAGAAGGCATTC
AGTTTGTGCTGGTCAGCCAGGAAAATGACGTCAGCACGATTACACAAATGGCGGATGAACTAAAAAGCATCTCCAGCCCG
CCTGTTCTTATCGACGATAAAGTATTCCCCCTCACTCTTAGCATTGGTATCAGCTACGATGTCGGCAAAAACCGCGATTA
CTTACTCTCGACCGCACATAACGCGATGGACTTTATTCGCAAAAACGGCGGTAACAGCTGGCAATTCTTTAACCCGGCAA
TGAATCAGATGGTAAAAGAACGGTTGATTCTTGGCGCTGCGTTAAAAGAAGCCATTGCCAATAATCAGTTGCGCCTTGTC
TACCAGCCACAAATCTACTCAGAGACAGGCGAACTGTATGGTTTTGAAGCGTTGGCCCGCTGGAACGATCCACAACACGG
TAATGTTCCGCCATCACGTTTTATTCCACTGGCCGAGGAAATTGGCGAAATTGAAAATATCGGTCGCTGGGTGGTACGTG
AGGCCTGTAGACAACTGGCAGAGTGGCGCAGCCTTGCGCTTAATATTCCAACATTATCAGTTAACTTATCAGCATTACAT
TTTCGCAGCAGCCAGTTGCCAAATCAGGTATCAGAAGCCATGGAGGAATTTGCCATACCCGGCGGTCAACTGACGGTAGA
AATCACTGAAAGTATGATGATGGAACAGAATGAAGAGATTCTGAGCCGAATTCAGATCCTGCGTAATATGGGCGTTGGTT
TGTCGGTAGATGACTTTGGTACGGGGTTTTCTGGCTTATCGCGTCTGGTAAGTTTGCCGGTTACTGAAATTAAAATCGAC
AAAAGCTTTGTTGATCGCTGTCTGAGTGAGAAACGGATTCGTTCGTTACTGGAAGCCATTACCAGTATCGGGCAGCGGCT
TAATCTTGAGGTCGTTGCTGAGGGTGTAGAGACCAAAGAGCAGTTTGAATTGTTACAGGAGATTCGTTGCCCGGTTATTC
AGGGTTACTTTTTTTCCCGGCCCTTACCCGCCGAAGATATCCCTGGCTGGATGACTTCGGCGCTTCCTCTGCGTATCGAC
TCTTAG

Upstream 100 bases:

>100_bases
GATGGCGGATGAAGCGCTGTATATTGCAAAAAGGCGAGGTAGAAATCGTGTTGAACTATGGAAAGCAAGTCTTTAAATAC
CATCGGATGCAGAGGTAATC

Downstream 100 bases:

>100_bases
TACACCTTGCCCACAAAGGTGGGCAAGATATCGAAGATCAAATAAGCTAGCGGGTTCTTATTTATCACCGAAATGGATCA
CCGTACGAATCGATTTTCCT

Product: cAMP phosphodiesterase

Products: NA

Alternate protein names: Direct oxygen sensing phosphodiesterase; Direct oxygen sensor protein; Ec DOS; Heme-regulated cyclic di-GMP phosphodiesterase, [H]

Number of amino acids: Translated: 801; Mature: 801

Protein sequence:

>801_residues
MKLTDAENSDDGIFFPALEQNMMGAVLINENDEVLFFNPAAEKLWGYTREEVIGNNISMLIPQDLRPAHPDYIRHNREGG
KPRVEGMSRELQLEKKDGSKIWTRFALSKVTAAGKIFYLALVRDASVEVAQKEQTRLLIIAVDHLDRPVIVLDPERRIVQ
CNRAFTEMFGHCVSEAAGKQPDELLNIPELPSDNRLRVKQLLWKYGRDQDEFLMLTRAGEKIWIKASISPVYDKMSVLQN
LVMTFSDITEERQIRQLEGNILAAMCSSPPFHEMGEIICRNIESILRNTHVSLYALRNSVPLHWASSSRDIDTTNAKVWS
LTIRQRDGAPAGTLLIKTIAGQETSGFIERVADISQHLAALALEQEKSRQHIEQLIQFDPLTGLPNRNNLHSYLDELVGK
DISPVVYLISIDNLQDVIDSLGYAWADQAVLEVVHRIRDKLKPDQYLCRVEGIQFVLVSQENDVSTITQMADELKSISSP
PVLIDDKVFPLTLSIGISYDVGKNRDYLLSTAHNAMDFIRKNGGNSWQFFNPAMNQMVKERLILGAALKEAIANNQLRLV
YQPQIYSETGELYGFEALARWNDPQHGNVPPSRFIPLAEEIGEIENIGRWVVREACRQLAEWRSLALNIPTLSVNLSALH
FRSSQLPNQVSEAMEEFAIPGGQLTVEITESMMMEQNEEILSRIQILRNMGVGLSVDDFGTGFSGLSRLVSLPVTEIKID
KSFVDRCLSEKRIRSLLEAITSIGQRLNLEVVAEGVETKEQFELLQEIRCPVIQGYFFSRPLPAEDIPGWMTSALPLRID
S

Sequences:

>Translated_801_residues
MKLTDAENSDDGIFFPALEQNMMGAVLINENDEVLFFNPAAEKLWGYTREEVIGNNISMLIPQDLRPAHPDYIRHNREGG
KPRVEGMSRELQLEKKDGSKIWTRFALSKVTAAGKIFYLALVRDASVEVAQKEQTRLLIIAVDHLDRPVIVLDPERRIVQ
CNRAFTEMFGHCVSEAAGKQPDELLNIPELPSDNRLRVKQLLWKYGRDQDEFLMLTRAGEKIWIKASISPVYDKMSVLQN
LVMTFSDITEERQIRQLEGNILAAMCSSPPFHEMGEIICRNIESILRNTHVSLYALRNSVPLHWASSSRDIDTTNAKVWS
LTIRQRDGAPAGTLLIKTIAGQETSGFIERVADISQHLAALALEQEKSRQHIEQLIQFDPLTGLPNRNNLHSYLDELVGK
DISPVVYLISIDNLQDVIDSLGYAWADQAVLEVVHRIRDKLKPDQYLCRVEGIQFVLVSQENDVSTITQMADELKSISSP
PVLIDDKVFPLTLSIGISYDVGKNRDYLLSTAHNAMDFIRKNGGNSWQFFNPAMNQMVKERLILGAALKEAIANNQLRLV
YQPQIYSETGELYGFEALARWNDPQHGNVPPSRFIPLAEEIGEIENIGRWVVREACRQLAEWRSLALNIPTLSVNLSALH
FRSSQLPNQVSEAMEEFAIPGGQLTVEITESMMMEQNEEILSRIQILRNMGVGLSVDDFGTGFSGLSRLVSLPVTEIKID
KSFVDRCLSEKRIRSLLEAITSIGQRLNLEVVAEGVETKEQFELLQEIRCPVIQGYFFSRPLPAEDIPGWMTSALPLRID
S
>Mature_801_residues
MKLTDAENSDDGIFFPALEQNMMGAVLINENDEVLFFNPAAEKLWGYTREEVIGNNISMLIPQDLRPAHPDYIRHNREGG
KPRVEGMSRELQLEKKDGSKIWTRFALSKVTAAGKIFYLALVRDASVEVAQKEQTRLLIIAVDHLDRPVIVLDPERRIVQ
CNRAFTEMFGHCVSEAAGKQPDELLNIPELPSDNRLRVKQLLWKYGRDQDEFLMLTRAGEKIWIKASISPVYDKMSVLQN
LVMTFSDITEERQIRQLEGNILAAMCSSPPFHEMGEIICRNIESILRNTHVSLYALRNSVPLHWASSSRDIDTTNAKVWS
LTIRQRDGAPAGTLLIKTIAGQETSGFIERVADISQHLAALALEQEKSRQHIEQLIQFDPLTGLPNRNNLHSYLDELVGK
DISPVVYLISIDNLQDVIDSLGYAWADQAVLEVVHRIRDKLKPDQYLCRVEGIQFVLVSQENDVSTITQMADELKSISSP
PVLIDDKVFPLTLSIGISYDVGKNRDYLLSTAHNAMDFIRKNGGNSWQFFNPAMNQMVKERLILGAALKEAIANNQLRLV
YQPQIYSETGELYGFEALARWNDPQHGNVPPSRFIPLAEEIGEIENIGRWVVREACRQLAEWRSLALNIPTLSVNLSALH
FRSSQLPNQVSEAMEEFAIPGGQLTVEITESMMMEQNEEILSRIQILRNMGVGLSVDDFGTGFSGLSRLVSLPVTEIKID
KSFVDRCLSEKRIRSLLEAITSIGQRLNLEVVAEGVETKEQFELLQEIRCPVIQGYFFSRPLPAEDIPGWMTSALPLRID
S

Specific function: In association with DosC is involved in the production and removal of the second messenger c-di-GMP in response to changing O(2) levels. Has phosphodiesterase (PDE) activity with c- di-GMP (PubMed:15995192), very poor activity on cAMP (PubMed:15995192) bu

COG id: COG2202

COG function: function code T; FOG: PAS/PAC domain

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 2 PAS (PER-ARNT-SIM) domains [H]

Homologues:

Organism=Escherichia coli, GI87081921, Length=799, Percent_Identity=83.2290362953692, Blast_Score=1404, Evalue=0.0,
Organism=Escherichia coli, GI1787541, Length=437, Percent_Identity=33.6384439359268, Blast_Score=240, Evalue=3e-64,
Organism=Escherichia coli, GI226510982, Length=446, Percent_Identity=30.2690582959641, Blast_Score=192, Evalue=7e-50,
Organism=Escherichia coli, GI87081845, Length=243, Percent_Identity=34.5679012345679, Blast_Score=150, Evalue=4e-37,
Organism=Escherichia coli, GI1790496, Length=251, Percent_Identity=35.8565737051793, Blast_Score=148, Evalue=1e-36,
Organism=Escherichia coli, GI87081980, Length=257, Percent_Identity=33.852140077821, Blast_Score=137, Evalue=4e-33,
Organism=Escherichia coli, GI1788502, Length=269, Percent_Identity=30.1115241635688, Blast_Score=132, Evalue=7e-32,
Organism=Escherichia coli, GI1786507, Length=301, Percent_Identity=29.2358803986711, Blast_Score=129, Evalue=5e-31,
Organism=Escherichia coli, GI1787055, Length=272, Percent_Identity=29.4117647058824, Blast_Score=127, Evalue=3e-30,
Organism=Escherichia coli, GI1788849, Length=449, Percent_Identity=25.8351893095768, Blast_Score=125, Evalue=8e-30,
Organism=Escherichia coli, GI87081743, Length=250, Percent_Identity=32, Blast_Score=123, Evalue=5e-29,
Organism=Escherichia coli, GI87082096, Length=264, Percent_Identity=27.6515151515151, Blast_Score=98, Evalue=2e-21,
Organism=Escherichia coli, GI1787410, Length=279, Percent_Identity=21.8637992831541, Blast_Score=64, Evalue=5e-11,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR001054
- InterPro:   IPR000160
- InterPro:   IPR001633
- InterPro:   IPR012226
- InterPro:   IPR001610
- InterPro:   IPR000014
- InterPro:   IPR000700
- InterPro:   IPR013656
- InterPro:   IPR013767 [H]

Pfam domain/function: PF00563 EAL; PF00990 GGDEF; PF00989 PAS; PF08448 PAS_4 [H]

EC number: =3.1.4.52 [H]

Molecular weight: Translated: 90445; Mature: 90445

Theoretical pI: Translated: 4.92; Mature: 4.92

Prosite motif: PS50112 PAS ; PS50113 PAC ; PS50883 EAL ; PS50887 GGDEF

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.0 %Cys     (Translated Protein)
2.6 %Met     (Translated Protein)
3.6 %Cys+Met (Translated Protein)
1.0 %Cys     (Mature Protein)
2.6 %Met     (Mature Protein)
3.6 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKLTDAENSDDGIFFPALEQNMMGAVLINENDEVLFFNPAAEKLWGYTREEVIGNNISML
CCCCCCCCCCCCEECCCHHCCCCEEEEECCCCCEEEECCHHHHHHCCCHHHHCCCCCEEE
IPQDLRPAHPDYIRHNREGGKPRVEGMSRELQLEKKDGSKIWTRFALSKVTAAGKIFYLA
ECCCCCCCCCHHHHCCCCCCCCHHHCCCHHEEEECCCCHHHHHHHHHHHHHHCCCEEEEE
LVRDASVEVAQKEQTRLLIIAVDHLDRPVIVLDPERRIVQCNRAFTEMFGHCVSEAAGKQ
EECCCCHHHHHCCCCEEEEEEECCCCCCEEEECCCHHHHHHHHHHHHHHHHHHHHHCCCC
PDELLNIPELPSDNRLRVKQLLWKYGRDQDEFLMLTRAGEKIWIKASISPVYDKMSVLQN
CHHHCCCCCCCCCCCHHHHHHHHHHCCCCCCEEEEEECCCEEEEEECCCHHHHHHHHHHH
LVMTFSDITEERQIRQLEGNILAAMCSSPPFHEMGEIICRNIESILRNTHVSLYALRNSV
HHHHHHHHHHHHHHHHHCCCEEEEECCCCCHHHHHHHHHHHHHHHHHCCCEEEEEECCCC
PLHWASSSRDIDTTNAKVWSLTIRQRDGAPAGTLLIKTIAGQETSGFIERVADISQHLAA
CEEECCCCCCCCCCCCEEEEEEEEECCCCCHHHEEEEECCCCCHHHHHHHHHHHHHHHHH
LALEQEKSRQHIEQLIQFDPLTGLPNRNNLHSYLDELVGKDISPVVYLISIDNLQDVIDS
HHHHHHHHHHHHHHHHHCCCCCCCCCCCCHHHHHHHHHCCCCCCEEEEEEECCHHHHHHH
LGYAWADQAVLEVVHRIRDKLKPDQYLCRVEGIQFVLVSQENDVSTITQMADELKSISSP
HCCHHHHHHHHHHHHHHHHHCCCHHHHHEECCEEEEEEECCCCHHHHHHHHHHHHHCCCC
PVLIDDKVFPLTLSIGISYDVGKNRDYLLSTAHNAMDFIRKNGGNSWQFFNPAMNQMVKE
CEEECCCEEEEEEEEEEEEECCCCCCHHHHHHHHHHHHHHHCCCCCCEEECHHHHHHHHH
RLILGAALKEAIANNQLRLVYQPQIYSETGELYGFEALARWNDPQHGNVPPSRFIPLAEE
HHHHHHHHHHHHCCCCEEEEECCCHHCCCCCHHCHHHHHHCCCCCCCCCCHHHCCCHHHH
IGEIENIGRWVVREACRQLAEWRSLALNIPTLSVNLSALHFRSSQLPNQVSEAMEEFAIP
HHHHHHHHHHHHHHHHHHHHHHHHHEEECCEEEEEHHHEEECHHCCCHHHHHHHHHHCCC
GGQLTVEITESMMMEQNEEILSRIQILRNMGVGLSVDDFGTGFSGLSRLVSLPVTEIKID
CCCEEEEEHHHHHHHCCHHHHHHHHHHHHCCCCCEECCCCCCHHHHHHHHHCCCHHEEEC
KSFVDRCLSEKRIRSLLEAITSIGQRLNLEVVAEGVETKEQFELLQEIRCPVIQGYFFSR
HHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHCCCCCHHHHHHHHHHCCCCEECHHHCC
PLPAEDIPGWMTSALPLRIDS
CCCCCCCCCHHHCCCCEEECC
>Mature Secondary Structure
MKLTDAENSDDGIFFPALEQNMMGAVLINENDEVLFFNPAAEKLWGYTREEVIGNNISML
CCCCCCCCCCCCEECCCHHCCCCEEEEECCCCCEEEECCHHHHHHCCCHHHHCCCCCEEE
IPQDLRPAHPDYIRHNREGGKPRVEGMSRELQLEKKDGSKIWTRFALSKVTAAGKIFYLA
ECCCCCCCCCHHHHCCCCCCCCHHHCCCHHEEEECCCCHHHHHHHHHHHHHHCCCEEEEE
LVRDASVEVAQKEQTRLLIIAVDHLDRPVIVLDPERRIVQCNRAFTEMFGHCVSEAAGKQ
EECCCCHHHHHCCCCEEEEEEECCCCCCEEEECCCHHHHHHHHHHHHHHHHHHHHHCCCC
PDELLNIPELPSDNRLRVKQLLWKYGRDQDEFLMLTRAGEKIWIKASISPVYDKMSVLQN
CHHHCCCCCCCCCCCHHHHHHHHHHCCCCCCEEEEEECCCEEEEEECCCHHHHHHHHHHH
LVMTFSDITEERQIRQLEGNILAAMCSSPPFHEMGEIICRNIESILRNTHVSLYALRNSV
HHHHHHHHHHHHHHHHHCCCEEEEECCCCCHHHHHHHHHHHHHHHHHCCCEEEEEECCCC
PLHWASSSRDIDTTNAKVWSLTIRQRDGAPAGTLLIKTIAGQETSGFIERVADISQHLAA
CEEECCCCCCCCCCCCEEEEEEEEECCCCCHHHEEEEECCCCCHHHHHHHHHHHHHHHHH
LALEQEKSRQHIEQLIQFDPLTGLPNRNNLHSYLDELVGKDISPVVYLISIDNLQDVIDS
HHHHHHHHHHHHHHHHHCCCCCCCCCCCCHHHHHHHHHCCCCCCEEEEEEECCHHHHHHH
LGYAWADQAVLEVVHRIRDKLKPDQYLCRVEGIQFVLVSQENDVSTITQMADELKSISSP
HCCHHHHHHHHHHHHHHHHHCCCHHHHHEECCEEEEEEECCCCHHHHHHHHHHHHHCCCC
PVLIDDKVFPLTLSIGISYDVGKNRDYLLSTAHNAMDFIRKNGGNSWQFFNPAMNQMVKE
CEEECCCEEEEEEEEEEEEECCCCCCHHHHHHHHHHHHHHHCCCCCCEEECHHHHHHHHH
RLILGAALKEAIANNQLRLVYQPQIYSETGELYGFEALARWNDPQHGNVPPSRFIPLAEE
HHHHHHHHHHHHCCCCEEEEECCCHHCCCCCHHCHHHHHHCCCCCCCCCCHHHCCCHHHH
IGEIENIGRWVVREACRQLAEWRSLALNIPTLSVNLSALHFRSSQLPNQVSEAMEEFAIP
HHHHHHHHHHHHHHHHHHHHHHHHHEEECCEEEEEHHHEEECHHCCCHHHHHHHHHHCCC
GGQLTVEITESMMMEQNEEILSRIQILRNMGVGLSVDDFGTGFSGLSRLVSLPVTEIKID
CCCEEEEEHHHHHHHCCHHHHHHHHHHHHCCCCCEECCCCCCHHHHHHHHHCCCHHEEEC
KSFVDRCLSEKRIRSLLEAITSIGQRLNLEVVAEGVETKEQFELLQEIRCPVIQGYFFSR
HHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHCCCCCHHHHHHHHHHCCCCEECHHHCC
PLPAEDIPGWMTSALPLRIDS
CCCCCCCCCHHHCCCCEEECC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 9097039; 9278503 [H]