Definition Haemophilus influenzae Rd KW20 chromosome, complete genome.
Accession NC_000907
Length 1,830,138

Click here to switch to the map view.

The map label for this gene is dmsA

Identifier: 16272979

GI number: 16272979

Start: 1111123

End: 1113543

Strand: Reverse

Name: dmsA

Synonym: HI1047

Alternate gene names: 16272979

Gene position: 1113543-1111123 (Counterclockwise)

Preceding gene: 16272983

Following gene: 16272978

Centisome position: 60.84

GC content: 38.54

Gene sequence:

>2421_bases
ATGAGTAACTTTAATCAAATAAGTCGCCGAGATTTTGTCAAGGCGTCATCTGCGGGAGCTGCACTGGCAGTTTCAAATCT
TACTTTACCTTTCAATGTAATGGCTAAAGAGACACAACGCCTCAATGAAAATAATCAAGAACGTATTGTTTGGAGTGCTT
GTACAGTAAACTGTGGTAGCCGTTGTCCATTACGAATGCACGTAAAAGATAACCGAATCACTTATGTGGAAACCGATAAT
ACGGGGACAGAAACATATAATCTTGATCATCAGGTTCGTGCTTGTCTACGTGGACGTTCTATGCGTCGTCGAGTATATAA
CCCAGACCGTTTAAAATATCCAATGAAACGTATAGGTAAACGCGGAGAAGGCAAATTCAAACGAATCAGTTGGGATGAGG
CTTTAACTGAAATTGCAGACGCATTGAAACGCAATATAAAAAAATATGGCAATGAATCAATTTATTTAAACTATGGTACG
GGAACACTCGGTGGCACAATGGCTAAATCTTGGCCACCTGCATCCACTATGATCGCTCGTTTTATGAATTGTATTGGTGG
ATATTTAAACCATTATGGTGATTACAGCACCGCACAAATTGCTGTCGGTTTAGATTATACCTATGGTGGTGGTTGGGCAT
TGGGAAATGGAATGGCTGACATTGAAAACACCAAATTAATAGTGTTATTCGGTAATAATCCTGCAGAAACTCGTATGAGT
GGAGGTGGTTTAACTTATTGTATTGAACAAGCCAAAGCTCGTTCCAATGCCAAAATGATTATTATCGATCCTCGTTATAA
TGATACTGGTGCAGGGCGTGAAGATGAGTGGATCCCAATTCGTCCAGGTACTGATGCAGCCCTTGTTGCTGCCCTTGCTT
ATGTAATGATTCAAGAAAATCTCGTGGATCAACCTTTCTTAGATAAATATTGTGTTGGTTATGATGAAAAAACATTACCT
ACGGATGCCCCTAAAAATGGTCATTATAAAGCCTATATTTTAGGTTATGGTAATGATGGTATCGCTAAAACCCCAGAATG
GGCGGCTAAAATCACGGGTATTCCGGCGGAGAGAATTATTAAACTCGCACGTGAAATTGGTAGTACAAAACCTGCCTTTA
TTTCCCAAGGTTGGGGGCCTCAACGTCGTAGTAATGGAGAATTAATCTCTCGTGCCATTGCGATGTTGCCAATCTTAACA
GGTAATGTTGGAATTCACGGCGGTAACACTGGTGCACGTGAAAGTGCGTATAGCATTCCATTTGTACGGATGCCAACGCT
AAAAAATCCTGTGAAAGCAAGCATTCCAATGTTTTTATGGACAGATGCAATTATTCGTGGCACAGAAATGACCGCACTTA
CAGATGGTATTCGTGGTGTTGATAAATTATCGTCCCCAATTAAAGTAATTTGGAATTACGCAAGTAACTGTTTGATTAAT
CAACACGCACAAATCAATCGTACTCACGATATTTTACAAGATGATACGCAATGTGAAATGATCATTACTATTGATAATCA
TATGACATCTACTGCCAAATACAGTGATATTTTATTACCAGATTGTACAACTTCAGAACAAATGGATTTCGCTTTAGATG
CCTTTGTATCCAATATGGCATATGTCATTTTTGCAGATCAAGTGATTAAACCATCTTTTGAATGTAGACCTATTTACGAT
ATGTTGAGTGATTTGGCTGAGAAAATGGGCGTAAAGGAAAAATTTACTGAAGGACGAACACAAGAAGAATGGTTACGCCA
TATTTATGAGCAATCTCGAGAAAAATTACCTGAATTACCTACTTTTGAAGAATTTAGACAACAAGGTATTTTTAAAAAAG
TTGATCCTAATGGCTTTAAAGTTGCATACAAAGATTTCCGTGATAATCCAGAAGCCCATCCACTTAAAACGCCATCTGGC
AAAATTGAAATTTATTCTTCTCGTCTAGCTGAAATAGCAAAAACTTGGAAATTAGCAGAAGATGACGTAATTCATCCCTT
ACCTATTCACGCCCAAAGTTTTGAGCATTACGGTGATCCATTAATGGAAAAATATCCGTTACAACTAAGTGGTTTTCACT
ATAAAGCGAGAACCCATTCAACTTATGGCAATGTGGATGTATTAAAAGCAGCTAATCCACAAGAAGTTTGGATGAATCCT
ATTGATGCAGAACCTCGTAATATTAAAAATGGCGATATGATTCGTATCTTTAATGATCGAGGCGAAGTACATATTAATGT
AAAAATTACACCCCGTATTATTCCAGGGGTTGTGGCATTAAGCGAGGGGGCTTGGTATGCACCAGATAAAGATCGTATCG
ATCATTCAGGTTGCATTAATGTACTTACGACACAACGCCCATCACCGCTTGCGAAAGGTAATCCGCAACATTCTAATTTA
GTTCAAGTGGAACGTTTGTAG

Upstream 100 bases:

>100_bases
ATTAATGATTAATTGATTTGGCTCAAGTAAAACTTCTATACAAAGATTATAATTAACTCGTTTTAGTTATTTTTCAATCT
GACTGTGGGGGAACGATATA

Downstream 100 bases:

>100_bases
GGGGAGAATTATGGAACAATATGGTTTTTATTTTGATTCTGAACGTTGCACAGGCTGTAAAACTTGTGAATTAGCCTGTA
AGGATTACAAAGATCTTGGC

Product: anaerobic dimethyl sulfoxide reductase chain A

Products: Reduced form of N-Oxide compounds [C]

Alternate protein names: DMSO reductase

Number of amino acids: Translated: 806; Mature: 805

Protein sequence:

>806_residues
MSNFNQISRRDFVKASSAGAALAVSNLTLPFNVMAKETQRLNENNQERIVWSACTVNCGSRCPLRMHVKDNRITYVETDN
TGTETYNLDHQVRACLRGRSMRRRVYNPDRLKYPMKRIGKRGEGKFKRISWDEALTEIADALKRNIKKYGNESIYLNYGT
GTLGGTMAKSWPPASTMIARFMNCIGGYLNHYGDYSTAQIAVGLDYTYGGGWALGNGMADIENTKLIVLFGNNPAETRMS
GGGLTYCIEQAKARSNAKMIIIDPRYNDTGAGREDEWIPIRPGTDAALVAALAYVMIQENLVDQPFLDKYCVGYDEKTLP
TDAPKNGHYKAYILGYGNDGIAKTPEWAAKITGIPAERIIKLAREIGSTKPAFISQGWGPQRRSNGELISRAIAMLPILT
GNVGIHGGNTGARESAYSIPFVRMPTLKNPVKASIPMFLWTDAIIRGTEMTALTDGIRGVDKLSSPIKVIWNYASNCLIN
QHAQINRTHDILQDDTQCEMIITIDNHMTSTAKYSDILLPDCTTSEQMDFALDAFVSNMAYVIFADQVIKPSFECRPIYD
MLSDLAEKMGVKEKFTEGRTQEEWLRHIYEQSREKLPELPTFEEFRQQGIFKKVDPNGFKVAYKDFRDNPEAHPLKTPSG
KIEIYSSRLAEIAKTWKLAEDDVIHPLPIHAQSFEHYGDPLMEKYPLQLSGFHYKARTHSTYGNVDVLKAANPQEVWMNP
IDAEPRNIKNGDMIRIFNDRGEVHINVKITPRIIPGVVALSEGAWYAPDKDRIDHSGCINVLTTQRPSPLAKGNPQHSNL
VQVERL

Sequences:

>Translated_806_residues
MSNFNQISRRDFVKASSAGAALAVSNLTLPFNVMAKETQRLNENNQERIVWSACTVNCGSRCPLRMHVKDNRITYVETDN
TGTETYNLDHQVRACLRGRSMRRRVYNPDRLKYPMKRIGKRGEGKFKRISWDEALTEIADALKRNIKKYGNESIYLNYGT
GTLGGTMAKSWPPASTMIARFMNCIGGYLNHYGDYSTAQIAVGLDYTYGGGWALGNGMADIENTKLIVLFGNNPAETRMS
GGGLTYCIEQAKARSNAKMIIIDPRYNDTGAGREDEWIPIRPGTDAALVAALAYVMIQENLVDQPFLDKYCVGYDEKTLP
TDAPKNGHYKAYILGYGNDGIAKTPEWAAKITGIPAERIIKLAREIGSTKPAFISQGWGPQRRSNGELISRAIAMLPILT
GNVGIHGGNTGARESAYSIPFVRMPTLKNPVKASIPMFLWTDAIIRGTEMTALTDGIRGVDKLSSPIKVIWNYASNCLIN
QHAQINRTHDILQDDTQCEMIITIDNHMTSTAKYSDILLPDCTTSEQMDFALDAFVSNMAYVIFADQVIKPSFECRPIYD
MLSDLAEKMGVKEKFTEGRTQEEWLRHIYEQSREKLPELPTFEEFRQQGIFKKVDPNGFKVAYKDFRDNPEAHPLKTPSG
KIEIYSSRLAEIAKTWKLAEDDVIHPLPIHAQSFEHYGDPLMEKYPLQLSGFHYKARTHSTYGNVDVLKAANPQEVWMNP
IDAEPRNIKNGDMIRIFNDRGEVHINVKITPRIIPGVVALSEGAWYAPDKDRIDHSGCINVLTTQRPSPLAKGNPQHSNL
VQVERL
>Mature_805_residues
SNFNQISRRDFVKASSAGAALAVSNLTLPFNVMAKETQRLNENNQERIVWSACTVNCGSRCPLRMHVKDNRITYVETDNT
GTETYNLDHQVRACLRGRSMRRRVYNPDRLKYPMKRIGKRGEGKFKRISWDEALTEIADALKRNIKKYGNESIYLNYGTG
TLGGTMAKSWPPASTMIARFMNCIGGYLNHYGDYSTAQIAVGLDYTYGGGWALGNGMADIENTKLIVLFGNNPAETRMSG
GGLTYCIEQAKARSNAKMIIIDPRYNDTGAGREDEWIPIRPGTDAALVAALAYVMIQENLVDQPFLDKYCVGYDEKTLPT
DAPKNGHYKAYILGYGNDGIAKTPEWAAKITGIPAERIIKLAREIGSTKPAFISQGWGPQRRSNGELISRAIAMLPILTG
NVGIHGGNTGARESAYSIPFVRMPTLKNPVKASIPMFLWTDAIIRGTEMTALTDGIRGVDKLSSPIKVIWNYASNCLINQ
HAQINRTHDILQDDTQCEMIITIDNHMTSTAKYSDILLPDCTTSEQMDFALDAFVSNMAYVIFADQVIKPSFECRPIYDM
LSDLAEKMGVKEKFTEGRTQEEWLRHIYEQSREKLPELPTFEEFRQQGIFKKVDPNGFKVAYKDFRDNPEAHPLKTPSGK
IEIYSSRLAEIAKTWKLAEDDVIHPLPIHAQSFEHYGDPLMEKYPLQLSGFHYKARTHSTYGNVDVLKAANPQEVWMNPI
DAEPRNIKNGDMIRIFNDRGEVHINVKITPRIIPGVVALSEGAWYAPDKDRIDHSGCINVLTTQRPSPLAKGNPQHSNLV
QVERL

Specific function: Terminal reductase during anaerobic growth on various sulfoxide and N-oxide compounds

COG id: COG0243

COG function: function code C; Anaerobic dehydrogenases, typically selenocysteine-containing

Gene ontology:

Cell location: Cell membrane; Peripheral membrane protein; Cytoplasmic side

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the prokaryotic molybdopterin-containing oxidoreductase family

Homologues:

Organism=Escherichia coli, GI87081797, Length=803, Percent_Identity=73.3499377334994, Blast_Score=1248, Evalue=0.0,
Organism=Escherichia coli, GI1787870, Length=805, Percent_Identity=63.8509316770186, Blast_Score=1106, Evalue=0.0,
Organism=Escherichia coli, GI171474008, Length=806, Percent_Identity=61.166253101737, Blast_Score=1039, Evalue=0.0,
Organism=Escherichia coli, GI1787231, Length=807, Percent_Identity=30.9789343246592, Blast_Score=302, Evalue=6e-83,
Organism=Escherichia coli, GI145693196, Length=759, Percent_Identity=31.2252964426877, Blast_Score=291, Evalue=1e-79,
Organism=Escherichia coli, GI87081994, Length=861, Percent_Identity=28.8037166085947, Blast_Score=273, Evalue=3e-74,
Organism=Escherichia coli, GI3868721, Length=798, Percent_Identity=25.062656641604, Blast_Score=143, Evalue=5e-35,
Organism=Escherichia coli, GI3868720, Length=469, Percent_Identity=26.0127931769723, Blast_Score=105, Evalue=8e-24,
Organism=Escherichia coli, GI1788534, Length=883, Percent_Identity=23.7825594563986, Blast_Score=98, Evalue=2e-21,
Organism=Escherichia coli, GI3868719, Length=461, Percent_Identity=25.3796095444685, Blast_Score=95, Evalue=2e-20,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): DMSA_HAEIN (P45004)

Other databases:

- EMBL:   L42023
- EMBL:   U26665
- PIR:   G64109
- RefSeq:   NP_439206.1
- ProteinModelPortal:   P45004
- GeneID:   950024
- GenomeReviews:   L42023_GR
- KEGG:   hin:HI1047
- NMPDR:   fig|71421.1.peg.1007
- TIGR:   HI_1047
- HOGENOM:   HBG304064
- OMA:   FRQQGIF
- ProtClustDB:   CLSK870600
- BioCyc:   HINF71421:HI_1047-MONOMER
- InterPro:   IPR011888
- InterPro:   IPR009010
- InterPro:   IPR006657
- InterPro:   IPR006656
- InterPro:   IPR006963
- InterPro:   IPR006655
- InterPro:   IPR006311
- Gene3D:   G3DSA:2.40.40.20
- SMART:   SM00926
- TIGRFAMs:   TIGR02166
- TIGRFAMs:   TIGR01409

Pfam domain/function: PF04879 Molybdop_Fe4S4; PF00384 Molybdopterin; PF01568 Molydop_binding; SSF50692 Asp_decarb_fold

EC number: 1.8.99.- [C]

Molecular weight: Translated: 90428; Mature: 90297

Theoretical pI: Translated: 8.26; Mature: 8.26

Prosite motif: PS00551 MOLYBDOPTERIN_PROK_1; PS00490 MOLYBDOPTERIN_PROK_2; PS00932 MOLYBDOPTERIN_PROK_3; PS51318 TAT

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.5 %Cys     (Translated Protein)
3.1 %Met     (Translated Protein)
4.6 %Cys+Met (Translated Protein)
1.5 %Cys     (Mature Protein)
3.0 %Met     (Mature Protein)
4.5 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSNFNQISRRDFVKASSAGAALAVSNLTLPFNVMAKETQRLNENNQERIVWSACTVNCGS
CCCHHHHHHHHHHHCCCCCCEEEEECCCCCHHHHHHHHHHHCCCCCCEEEEEEEEECCCC
RCPLRMHVKDNRITYVETDNTGTETYNLDHQVRACLRGRSMRRRVYNPDRLKYPMKRIGK
CCCEEEEEECCEEEEEEECCCCCEEECCHHHHHHHHHCHHHHHHCCCCHHHHHHHHHCCC
RGEGKFKRISWDEALTEIADALKRNIKKYGNESIYLNYGTGTLGGTMAKSWPPASTMIAR
CCCCCEEEECHHHHHHHHHHHHHHHHHHHCCCEEEEECCCCCCCCCCCCCCCCHHHHHHH
FMNCIGGYLNHYGDYSTAQIAVGLDYTYGGGWALGNGMADIENTKLIVLFGNNPAETRMS
HHHHHHHHHHHCCCCCCEEEEEEEEEECCCCEEECCCCCCCCCCEEEEEECCCCHHCEEC
GGGLTYCIEQAKARSNAKMIIIDPRYNDTGAGREDEWIPIRPGTDAALVAALAYVMIQEN
CCCHHHHHHHHHHCCCCEEEEECCCCCCCCCCCCCCEEECCCCCCHHHHHHHHHHHHHHH
LVDQPFLDKYCVGYDEKTLPTDAPKNGHYKAYILGYGNDGIAKTPEWAAKITGIPAERII
CCCCCCHHHHHCCCCCCCCCCCCCCCCCEEEEEEEECCCCCCCCCCHHHHCCCCCHHHHH
KLAREIGSTKPAFISQGWGPQRRSNGELISRAIAMLPILTGNVGIHGGNTGARESAYSIP
HHHHHHCCCCCCHHCCCCCCCCCCCHHHHHHHHHHHHHEECCEEEECCCCCCCCCCCCCC
FVRMPTLKNPVKASIPMFLWTDAIIRGTEMTALTDGIRGVDKLSSPIKVIWNYASNCLIN
EEECCCCCCCCHHCCCHHEEHHHHHCCCCHHHHHHHHHHHHHHCCHHHHHHHHHHCCEEC
QHAQINRTHDILQDDTQCEMIITIDNHMTSTAKYSDILLPDCTTSEQMDFALDAFVSNMA
CCCCCCCHHHHHCCCCCEEEEEEECCCCCCCCCCCCEECCCCCCCHHHHHHHHHHHHCCE
YVIFADQVIKPSFECRPIYDMLSDLAEKMGVKEKFTEGRTQEEWLRHIYEQSREKLPELP
EEEEEHHHHCCCCCCCCHHHHHHHHHHHCCCHHHHHCCCCHHHHHHHHHHHHHHHCCCCC
TFEEFRQQGIFKKVDPNGFKVAYKDFRDNPEAHPLKTPSGKIEIYSSRLAEIAKTWKLAE
CHHHHHHCCCCEECCCCCEEEEEEHHCCCCCCCCCCCCCCCEEEHHHHHHHHHHHHCCCC
DDVIHPLPIHAQSFEHYGDPLMEKYPLQLSGFHYKARTHSTYGNVDVLKAANPQEVWMNP
CCCCCCCCCCHHHHHHHCCHHHHHCCCEECCEEEEEECCCCCCCEEEEECCCCHHHCCCC
IDAEPRNIKNGDMIRIFNDRGEVHINVKITPRIIPGVVALSEGAWYAPDKDRIDHSGCIN
CCCCCCCCCCCCEEEEECCCCEEEEEEEECCCCCCCEEEECCCCEECCCCCCCCCCCCEE
VLTTQRPSPLAKGNPQHSNLVQVERL
EEECCCCCCCCCCCCCCCCCEEEECC
>Mature Secondary Structure 
SNFNQISRRDFVKASSAGAALAVSNLTLPFNVMAKETQRLNENNQERIVWSACTVNCGS
CCHHHHHHHHHHHCCCCCCEEEEECCCCCHHHHHHHHHHHCCCCCCEEEEEEEEECCCC
RCPLRMHVKDNRITYVETDNTGTETYNLDHQVRACLRGRSMRRRVYNPDRLKYPMKRIGK
CCCEEEEEECCEEEEEEECCCCCEEECCHHHHHHHHHCHHHHHHCCCCHHHHHHHHHCCC
RGEGKFKRISWDEALTEIADALKRNIKKYGNESIYLNYGTGTLGGTMAKSWPPASTMIAR
CCCCCEEEECHHHHHHHHHHHHHHHHHHHCCCEEEEECCCCCCCCCCCCCCCCHHHHHHH
FMNCIGGYLNHYGDYSTAQIAVGLDYTYGGGWALGNGMADIENTKLIVLFGNNPAETRMS
HHHHHHHHHHHCCCCCCEEEEEEEEEECCCCEEECCCCCCCCCCEEEEEECCCCHHCEEC
GGGLTYCIEQAKARSNAKMIIIDPRYNDTGAGREDEWIPIRPGTDAALVAALAYVMIQEN
CCCHHHHHHHHHHCCCCEEEEECCCCCCCCCCCCCCEEECCCCCCHHHHHHHHHHHHHHH
LVDQPFLDKYCVGYDEKTLPTDAPKNGHYKAYILGYGNDGIAKTPEWAAKITGIPAERII
CCCCCCHHHHHCCCCCCCCCCCCCCCCCEEEEEEEECCCCCCCCCCHHHHCCCCCHHHHH
KLAREIGSTKPAFISQGWGPQRRSNGELISRAIAMLPILTGNVGIHGGNTGARESAYSIP
HHHHHHCCCCCCHHCCCCCCCCCCCHHHHHHHHHHHHHEECCEEEECCCCCCCCCCCCCC
FVRMPTLKNPVKASIPMFLWTDAIIRGTEMTALTDGIRGVDKLSSPIKVIWNYASNCLIN
EEECCCCCCCCHHCCCHHEEHHHHHCCCCHHHHHHHHHHHHHHCCHHHHHHHHHHCCEEC
QHAQINRTHDILQDDTQCEMIITIDNHMTSTAKYSDILLPDCTTSEQMDFALDAFVSNMA
CCCCCCCHHHHHCCCCCEEEEEEECCCCCCCCCCCCEECCCCCCCHHHHHHHHHHHHCCE
YVIFADQVIKPSFECRPIYDMLSDLAEKMGVKEKFTEGRTQEEWLRHIYEQSREKLPELP
EEEEEHHHHCCCCCCCCHHHHHHHHHHHCCCHHHHHCCCCHHHHHHHHHHHHHHHCCCCC
TFEEFRQQGIFKKVDPNGFKVAYKDFRDNPEAHPLKTPSGKIEIYSSRLAEIAKTWKLAE
CHHHHHHCCCCEECCCCCEEEEEEHHCCCCCCCCCCCCCCCEEEHHHHHHHHHHHHCCCC
DDVIHPLPIHAQSFEHYGDPLMEKYPLQLSGFHYKARTHSTYGNVDVLKAANPQEVWMNP
CCCCCCCCCCHHHHHHHCCHHHHHCCCEECCEEEEEECCCCCCCEEEEECCCCHHHCCCC
IDAEPRNIKNGDMIRIFNDRGEVHINVKITPRIIPGVVALSEGAWYAPDKDRIDHSGCIN
CCCCCCCCCCCCEEEEECCCCEEEEEEEECCCCCCCEEEECCCCEECCCCCCCCCCCCEE
VLTTQRPSPLAKGNPQHSNLVQVERL
EEECCCCCCCCCCCCCCCCCEEEECC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: May Bind 4Fe-4S Cluster. [C]

Metal ions: Fe; Mo [C]

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: N-Oxide; Sulfoxide Compounds Including Trimethylamine N-Oxide. [C]

Specific reaction: Reduces Various N-Oxide And Sulfoxide Compounds Including Trimethylamine N-Oxide. [C]

General reaction: Oxidoreductases [C]

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 7542800; 8635740