Definition Serratia proteamaculans 568 chromosome, complete genome.
Accession NC_009832
Length 5,448,853

Click here to switch to the map view.

The map label for this gene is dhaR [H]

Identifier: 157372502

GI number: 157372502

Start: 4733066

End: 4735012

Strand: Direct

Name: dhaR [H]

Synonym: Spro_4269

Alternate gene names: 157372502

Gene position: 4733066-4735012 (Clockwise)

Preceding gene: 157372501

Following gene: 157372507

Centisome position: 86.86

GC content: 60.66

Gene sequence:

>1947_bases
ATGGAAAACACCTCAAGCTGGCAACGCCTGATCGAAGGCAACCTGCCACCCGAACAACGTCCTGCGCCGGCAATCTATGC
TTCCTGGCTACGCTGCCGCAGCCTGATGCAGCCCGCGGTGTGGAAAGCCCCCCACTGCGCACTCGGCGCTACCTTTAACT
CCATCTGCCAGCGTAAGAACGATCTGCTGACGCTCGGCCAGGCGGCGCTGGAAGACGCTTGCGAGTACATGGAACAACGG
CGCTGCCTGCTGATGATCCTCGACGAAAGCGGCTGCATGCTGTGGCTGTGTGGCGATGCCCCAACGCGCGAACGTCTGCA
ACAGTTGGGTTTTATGCCTGGCGCTTATTGGGCCGAAGGTGACATCGGCACCAATGCACCGTCACTGGCGGTGGCGGAGG
GCCACCCAATGCAGGTCCGCGGCAGCGAACATGTGCGCGAGGCGCTGCACGACTGGTCATTCTGCGCCACGCCGGTCTAT
GACAACAGTGGCCGCCAACGCGGCTCGATCGCATTAGGCTGCCTGCTTGCCGACTGTGCCGCCGGCGATTTGTCACTGAC
GCTGGCGCTGGCACGTGAGATCGGTAATTCAATCAACGCCGACAGCCTGCTGGCGGAATCCAACCGCCATCTGAATCAGC
TATACGGCCTGCTCGACGGGGTGGATGACGGCGTCATGGCCTGGGACCATCGCGGCTACCTGCAGTACATCAATCAGCGT
GCCGCTTCCTTGCTCAAGCTGGATGAACAACAAAGTCAGGGCAAGCCCCTGAGCCAGTTACTGACGCTGCCCGCCCTGCT
CAACCGGGCCATCGCCCAGCGGCAGCCACTGCAACATGTTGAAGTGACCTTCGAAAGCCAGCGGCAGTTTATTGCGGCGC
TGTTAACCCTCAAACCAATCTTCGACGGTGAGCGCTGCAGCTTTATTGCCCTGCTCCATCCGCTCGAACGACTGCATCAG
TATGTCAGCAGCCAGCTGGGGCGCGTCAGCCACAGTTTTGAACAGATGCCTTCCGCCTCGCTGGAGATGCGGCGGTTGAT
TCGCTATGGCCAACAGGCGGCGAAGGGTCAGCACCCGATCCTGCTGTGCGGCGAAGAAGGTGTTGGCAAGGAGCTACTCA
GCCAGGCGATCCACAACGCCAGTGAGCGCGCCACCGGGCCTTACATCGCCCTCAATTGCCAGCTCTTGCCGGAGGCTCAG
GGGCTGCGGGAGCTGCTCGGCAGCGATGCCAACGAGGAAGAGGCGGGCCAGCTCAGCAAGTTTGAACTGGCCAATGGCGG
TACGCTGTACCTGGAACAAATAGAGTATTTGCCGGCGGAGATGCAGTCTGCGCTGCTGCAGGTGCTGAAAACCGGCGTAG
TCATGCGGCTCAATTCAAATCGGGTGATCCCGGTCGATGTGCGGGTGATCGCCAGCAGCGCCGCCGATCTGCCGCTGTTG
GTGCAACAGAATCGCTTTCGCCGGCAACTGTTCTACAGCCTGCAGGCGTTCGAGATCCAAATCCCGGCGCTGCGCCAACG
GCTGAGTGATATTCCGCTGCTGGTGAAGCACCACCTGCGCACGCTGGAACAGCATTTCCAGTGCCGTTTTCGGGTGGATG
ACGAAGTGATGGTCCAGCTCGGTCTGTATCTGTGGCCCGGCAACGATCTGGAGCTGAAGGGGGTGGTGGAGCGCACCGCG
ATGATGTGCCACGGCCACCATCTGCAACTGGCGGACTTGCCCGAGCACTTGCTCAGCCACCAGCCACTGCTGGAAAGTGA
ACCGCAGCCGGGCATACCGCTATTAACACTGGCGGAGATGGAACGTCAGGCGATCATTCACGCGGCAAACGTCAGCCGCG
GGCAATTGAACGAAATGGCGCAGCTGCTGGGCATTGGTCGCACCACGCTGTGGCGAAAAATCAAACAGCATCAGATTGAT
ATTCGCCAGTTTAAGCTGCGCGCCTGA

Upstream 100 bases:

>100_bases
TTTGCCTGCTCATCGGTTCTGCCCACCGCCTCACAGCCGTTCCCCCACCCTGGGGTGGTATCATCCAGGTTATCGCTTTA
TCTCGTCTGGACGGGATCCA

Downstream 100 bases:

>100_bases
GGGCATGCCGTCAGTGGCTGAGTTGCAACACACCGCGCGCCGCATCCAGCATCGCTTTCTGACCGTTGCGGGTTTTGCTG
ATGCAATCGTTCATGCCCAC

Product: DNA-binding transcriptional regulator DhaR

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 648; Mature: 648

Protein sequence:

>648_residues
MENTSSWQRLIEGNLPPEQRPAPAIYASWLRCRSLMQPAVWKAPHCALGATFNSICQRKNDLLTLGQAALEDACEYMEQR
RCLLMILDESGCMLWLCGDAPTRERLQQLGFMPGAYWAEGDIGTNAPSLAVAEGHPMQVRGSEHVREALHDWSFCATPVY
DNSGRQRGSIALGCLLADCAAGDLSLTLALAREIGNSINADSLLAESNRHLNQLYGLLDGVDDGVMAWDHRGYLQYINQR
AASLLKLDEQQSQGKPLSQLLTLPALLNRAIAQRQPLQHVEVTFESQRQFIAALLTLKPIFDGERCSFIALLHPLERLHQ
YVSSQLGRVSHSFEQMPSASLEMRRLIRYGQQAAKGQHPILLCGEEGVGKELLSQAIHNASERATGPYIALNCQLLPEAQ
GLRELLGSDANEEEAGQLSKFELANGGTLYLEQIEYLPAEMQSALLQVLKTGVVMRLNSNRVIPVDVRVIASSAADLPLL
VQQNRFRRQLFYSLQAFEIQIPALRQRLSDIPLLVKHHLRTLEQHFQCRFRVDDEVMVQLGLYLWPGNDLELKGVVERTA
MMCHGHHLQLADLPEHLLSHQPLLESEPQPGIPLLTLAEMERQAIIHAANVSRGQLNEMAQLLGIGRTTLWRKIKQHQID
IRQFKLRA

Sequences:

>Translated_648_residues
MENTSSWQRLIEGNLPPEQRPAPAIYASWLRCRSLMQPAVWKAPHCALGATFNSICQRKNDLLTLGQAALEDACEYMEQR
RCLLMILDESGCMLWLCGDAPTRERLQQLGFMPGAYWAEGDIGTNAPSLAVAEGHPMQVRGSEHVREALHDWSFCATPVY
DNSGRQRGSIALGCLLADCAAGDLSLTLALAREIGNSINADSLLAESNRHLNQLYGLLDGVDDGVMAWDHRGYLQYINQR
AASLLKLDEQQSQGKPLSQLLTLPALLNRAIAQRQPLQHVEVTFESQRQFIAALLTLKPIFDGERCSFIALLHPLERLHQ
YVSSQLGRVSHSFEQMPSASLEMRRLIRYGQQAAKGQHPILLCGEEGVGKELLSQAIHNASERATGPYIALNCQLLPEAQ
GLRELLGSDANEEEAGQLSKFELANGGTLYLEQIEYLPAEMQSALLQVLKTGVVMRLNSNRVIPVDVRVIASSAADLPLL
VQQNRFRRQLFYSLQAFEIQIPALRQRLSDIPLLVKHHLRTLEQHFQCRFRVDDEVMVQLGLYLWPGNDLELKGVVERTA
MMCHGHHLQLADLPEHLLSHQPLLESEPQPGIPLLTLAEMERQAIIHAANVSRGQLNEMAQLLGIGRTTLWRKIKQHQID
IRQFKLRA
>Mature_648_residues
MENTSSWQRLIEGNLPPEQRPAPAIYASWLRCRSLMQPAVWKAPHCALGATFNSICQRKNDLLTLGQAALEDACEYMEQR
RCLLMILDESGCMLWLCGDAPTRERLQQLGFMPGAYWAEGDIGTNAPSLAVAEGHPMQVRGSEHVREALHDWSFCATPVY
DNSGRQRGSIALGCLLADCAAGDLSLTLALAREIGNSINADSLLAESNRHLNQLYGLLDGVDDGVMAWDHRGYLQYINQR
AASLLKLDEQQSQGKPLSQLLTLPALLNRAIAQRQPLQHVEVTFESQRQFIAALLTLKPIFDGERCSFIALLHPLERLHQ
YVSSQLGRVSHSFEQMPSASLEMRRLIRYGQQAAKGQHPILLCGEEGVGKELLSQAIHNASERATGPYIALNCQLLPEAQ
GLRELLGSDANEEEAGQLSKFELANGGTLYLEQIEYLPAEMQSALLQVLKTGVVMRLNSNRVIPVDVRVIASSAADLPLL
VQQNRFRRQLFYSLQAFEIQIPALRQRLSDIPLLVKHHLRTLEQHFQCRFRVDDEVMVQLGLYLWPGNDLELKGVVERTA
MMCHGHHLQLADLPEHLLSHQPLLESEPQPGIPLLTLAEMERQAIIHAANVSRGQLNEMAQLLGIGRTTLWRKIKQHQID
IRQFKLRA

Specific function: Transcriptional activator of the glycerol utilization dha operon [H]

COG id: COG3284

COG function: function code QK; Transcriptional activator of acetoin/glycerol metabolism

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 sigma-54 factor interaction domain [H]

Homologues:

Organism=Escherichia coli, GI87081858, Length=626, Percent_Identity=54.3130990415335, Blast_Score=698, Evalue=0.0,
Organism=Escherichia coli, GI87082117, Length=322, Percent_Identity=34.7826086956522, Blast_Score=170, Evalue=2e-43,
Organism=Escherichia coli, GI1789087, Length=327, Percent_Identity=33.0275229357798, Blast_Score=162, Evalue=5e-41,
Organism=Escherichia coli, GI1790437, Length=455, Percent_Identity=31.4285714285714, Blast_Score=160, Evalue=2e-40,
Organism=Escherichia coli, GI1788550, Length=336, Percent_Identity=32.1428571428571, Blast_Score=160, Evalue=2e-40,
Organism=Escherichia coli, GI1788905, Length=312, Percent_Identity=34.9358974358974, Blast_Score=159, Evalue=6e-40,
Organism=Escherichia coli, GI1790299, Length=331, Percent_Identity=32.02416918429, Blast_Score=150, Evalue=3e-37,
Organism=Escherichia coli, GI1789233, Length=439, Percent_Identity=28.0182232346241, Blast_Score=148, Evalue=1e-36,
Organism=Escherichia coli, GI1786524, Length=308, Percent_Identity=34.0909090909091, Blast_Score=142, Evalue=8e-35,
Organism=Escherichia coli, GI1787583, Length=309, Percent_Identity=30.0970873786408, Blast_Score=137, Evalue=2e-33,
Organism=Escherichia coli, GI87082152, Length=240, Percent_Identity=36.25, Blast_Score=131, Evalue=1e-31,
Organism=Escherichia coli, GI87081872, Length=295, Percent_Identity=31.5254237288136, Blast_Score=130, Evalue=3e-31,
Organism=Escherichia coli, GI1789828, Length=233, Percent_Identity=30.0429184549356, Blast_Score=85, Evalue=1e-17,

Paralogues:

None

Copy number: 10-20 Molecules/Cell [C]

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR003593
- InterPro:   IPR003018
- InterPro:   IPR009057
- InterPro:   IPR002197
- InterPro:   IPR000014
- InterPro:   IPR013767
- InterPro:   IPR002078 [H]

Pfam domain/function: PF01590 GAF; PF02954 HTH_8; PF00989 PAS; PF00158 Sigma54_activat [H]

EC number: NA

Molecular weight: Translated: 72579; Mature: 72579

Theoretical pI: Translated: 6.58; Mature: 6.58

Prosite motif: PS50112 PAS ; PS00675 SIGMA54_INTERACT_1 ; PS50045 SIGMA54_INTERACT_4

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

2.3 %Cys     (Translated Protein)
2.6 %Met     (Translated Protein)
4.9 %Cys+Met (Translated Protein)
2.3 %Cys     (Mature Protein)
2.6 %Met     (Mature Protein)
4.9 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MENTSSWQRLIEGNLPPEQRPAPAIYASWLRCRSLMQPAVWKAPHCALGATFNSICQRKN
CCCHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHCCHHCCCCCHHHHHHHHHHHHCCC
DLLTLGQAALEDACEYMEQRRCLLMILDESGCMLWLCGDAPTRERLQQLGFMPGAYWAEG
HHHHHHHHHHHHHHHHHHCCCEEEEEEECCCCEEEEECCCCHHHHHHHHCCCCCCCCCCC
DIGTNAPSLAVAEGHPMQVRGSEHVREALHDWSFCATPVYDNSGRQRGSIALGCLLADCA
CCCCCCCCEEEECCCCEEECCHHHHHHHHHCCCCEECCCCCCCCCCCCCHHHHHHHHHHC
AGDLSLTLALAREIGNSINADSLLAESNRHLNQLYGLLDGVDDGVMAWDHRGYLQYINQR
CCCHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHCCCCCCEEECCCHHHHHHHHH
AASLLKLDEQQSQGKPLSQLLTLPALLNRAIAQRQPLQHVEVTFESQRQFIAALLTLKPI
HHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHC
FDGERCSFIALLHPLERLHQYVSSQLGRVSHSFEQMPSASLEMRRLIRYGQQAAKGQHPI
CCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHCCCCCE
LLCGEEGVGKELLSQAIHNASERATGPYIALNCQLLPEAQGLRELLGSDANEEEAGQLSK
EEECCCCCCHHHHHHHHHCCHHCCCCCEEEEEEEECCCHHHHHHHHCCCCCCHHHCCCHH
FELANGGTLYLEQIEYLPAEMQSALLQVLKTGVVMRLNSNRVIPVDVRVIASSAADLPLL
EEECCCCEEEHHHHHHCHHHHHHHHHHHHHCCEEEEECCCCEEEEEHHEEECCCCCCCHH
VQQNRFRRQLFYSLQAFEIQIPALRQRLSDIPLLVKHHLRTLEQHFQCRFRVDDEVMVQL
HHHHHHHHHHHHHHHHHEEECHHHHHHHHCCHHHHHHHHHHHHHHHHEEECCCHHHHHHC
GLYLWPGNDLELKGVVERTAMMCHGHHLQLADLPEHLLSHQPLLESEPQPGIPLLTLAEM
CCEEECCCCCCHHHHHHHHHHHHCCCCCCHHHHHHHHHCCCCCCCCCCCCCCCEEHHHHH
ERQAIIHAANVSRGQLNEMAQLLGIGRTTLWRKIKQHQIDIRQFKLRA
HHHHHHHHCCCCHHHHHHHHHHHHCCHHHHHHHHHHHHCCHHHHEECC
>Mature Secondary Structure
MENTSSWQRLIEGNLPPEQRPAPAIYASWLRCRSLMQPAVWKAPHCALGATFNSICQRKN
CCCHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHCCHHCCCCCHHHHHHHHHHHHCCC
DLLTLGQAALEDACEYMEQRRCLLMILDESGCMLWLCGDAPTRERLQQLGFMPGAYWAEG
HHHHHHHHHHHHHHHHHHCCCEEEEEEECCCCEEEEECCCCHHHHHHHHCCCCCCCCCCC
DIGTNAPSLAVAEGHPMQVRGSEHVREALHDWSFCATPVYDNSGRQRGSIALGCLLADCA
CCCCCCCCEEEECCCCEEECCHHHHHHHHHCCCCEECCCCCCCCCCCCCHHHHHHHHHHC
AGDLSLTLALAREIGNSINADSLLAESNRHLNQLYGLLDGVDDGVMAWDHRGYLQYINQR
CCCHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHCCCCCCEEECCCHHHHHHHHH
AASLLKLDEQQSQGKPLSQLLTLPALLNRAIAQRQPLQHVEVTFESQRQFIAALLTLKPI
HHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHC
FDGERCSFIALLHPLERLHQYVSSQLGRVSHSFEQMPSASLEMRRLIRYGQQAAKGQHPI
CCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHCCCCCE
LLCGEEGVGKELLSQAIHNASERATGPYIALNCQLLPEAQGLRELLGSDANEEEAGQLSK
EEECCCCCCHHHHHHHHHCCHHCCCCCEEEEEEEECCCHHHHHHHHCCCCCCHHHCCCHH
FELANGGTLYLEQIEYLPAEMQSALLQVLKTGVVMRLNSNRVIPVDVRVIASSAADLPLL
EEECCCCEEEHHHHHHCHHHHHHHHHHHHHCCEEEEECCCCEEEEEHHEEECCCCCCCHH
VQQNRFRRQLFYSLQAFEIQIPALRQRLSDIPLLVKHHLRTLEQHFQCRFRVDDEVMVQL
HHHHHHHHHHHHHHHHHEEECHHHHHHHHCCHHHHHHHHHHHHHHHHEEECCCHHHHHHC
GLYLWPGNDLELKGVVERTAMMCHGHHLQLADLPEHLLSHQPLLESEPQPGIPLLTLAEM
CCEEECCCCCCHHHHHHHHHHHHCCCCCCHHHHHHHHHCCCCCCCCCCCCCCCEEHHHHH
ERQAIIHAANVSRGQLNEMAQLLGIGRTTLWRKIKQHQIDIRQFKLRA
HHHHHHHHCCCCHHHHHHHHHHHHCCHHHHHHHHHHHHCCHHHHEECC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: DNA [C]

Specific reaction: Protein + DNA = Protein-DNA [C]

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA