Definition Desulfovibrio desulfuricans subsp. desulfuricans str. G20 chromosome, complete genome.
Accession NC_007519
Length 3,730,232

Click here to switch to the map view.

The map label for this gene is rob [H]

Identifier: 78358741

GI number: 78358741

Start: 3664296

End: 3665222

Strand: Reverse

Name: rob [H]

Synonym: Dde_3702

Alternate gene names: 78358741

Gene position: 3665222-3664296 (Counterclockwise)

Preceding gene: 78358755

Following gene: 78358721

Centisome position: 98.26

GC content: 58.04

Gene sequence:

>927_bases
ATGCTGTATACCGCTGCAAAGGGAAACAGCATTATGCAGGAACACGCGCACGAGACATACCGCATGCGTATCATGCGGGC
CATACTGTGGCTGGAAGAGCATATGAACGAGGCTGTGAGTCTTGATGATATGGCCGCGCAGGCTCATTTTTCACCGTATC
ACTTCCACCGGATATTCCGCGGAGTGGCGGGAGAATCGGTGATGGCCTACATACGGCGGCTGAGGCTGGAAAAGGCGGTG
CACCGTCTGGCTTACGGCAGCGCTTCAGTGACCGATATCGCCTTTGATGCCGGATACGAAGCGCATGAAGCATTCAGCAG
AGCTTTCAGGGCACAGTTCGGCATGTCTCCCTCCGCGCTGCGCAGGCATGTGCGAAAAGCGGGAATGATTCCCGCCGGAG
TTCTGGGAGAATCCGCCATGACCAAAGTGGTAGCCGGTTTCACGTTGGAAAGTCTGGGGCTGGAGCCTGAAGTGAAGGTT
CTGGCTCCTGTCCGGGTGGCCTTTGTCAGACACACCGGCCCGTATGCGCAATGCGAGGCCGCCTGGAAAACCCTGTGCGA
CTGGGCGTTTCCGCAAGGGCTGGTGATGGCACAGACACAGTTTATGGGCATCTGCTACGATGACCCCGAAGTGACCGCAC
CGGATAAAATCCGTTACGATGCCTGCATATCGGTGCCGGATAATGTGCAGGCTGAGCATCCTGTGGCCATACGCGAGGTG
GAAGGCGGCGAATATGTATGCGCCGTGTGGAAAGGCCCCTACACAGGGTTGACCAATGCCTATGCCGCGTTGTGCGGGCA
ATGGGGCGGCCGTTCCGGCAGAGAATTCCGCGCAGCGCCCAGTGTCGAGGTGTATCTTAATGACTGCACATCAACGCCGG
AACAGGAGTTGCTGACGGAAATCCGCATGCCGCTGATGCCGCGCTGA

Upstream 100 bases:

>100_bases
GGCTGTCAAGCGGCAGCGGCAGCCCCCCGCGGGGAAGTAAGCTCTGCTGTCGTGTCCCGCGGGGACATTGCGCAAAAAAA
GTCATGTGGGAGCACCGTAC

Downstream 100 bases:

>100_bases
GGGCGGCGGCTGTGAACAGAATATGCCCGCGGTTCTGCCGCGGGCTTTTTTACGGCTGGTCAGGGGGGGGGCTGGGGCTG
GTCAGGGGTTGGTCAGGGGT

Product: AraC type transcriptional regulator

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 308; Mature: 308

Protein sequence:

>308_residues
MLYTAAKGNSIMQEHAHETYRMRIMRAILWLEEHMNEAVSLDDMAAQAHFSPYHFHRIFRGVAGESVMAYIRRLRLEKAV
HRLAYGSASVTDIAFDAGYEAHEAFSRAFRAQFGMSPSALRRHVRKAGMIPAGVLGESAMTKVVAGFTLESLGLEPEVKV
LAPVRVAFVRHTGPYAQCEAAWKTLCDWAFPQGLVMAQTQFMGICYDDPEVTAPDKIRYDACISVPDNVQAEHPVAIREV
EGGEYVCAVWKGPYTGLTNAYAALCGQWGGRSGREFRAAPSVEVYLNDCTSTPEQELLTEIRMPLMPR

Sequences:

>Translated_308_residues
MLYTAAKGNSIMQEHAHETYRMRIMRAILWLEEHMNEAVSLDDMAAQAHFSPYHFHRIFRGVAGESVMAYIRRLRLEKAV
HRLAYGSASVTDIAFDAGYEAHEAFSRAFRAQFGMSPSALRRHVRKAGMIPAGVLGESAMTKVVAGFTLESLGLEPEVKV
LAPVRVAFVRHTGPYAQCEAAWKTLCDWAFPQGLVMAQTQFMGICYDDPEVTAPDKIRYDACISVPDNVQAEHPVAIREV
EGGEYVCAVWKGPYTGLTNAYAALCGQWGGRSGREFRAAPSVEVYLNDCTSTPEQELLTEIRMPLMPR
>Mature_308_residues
MLYTAAKGNSIMQEHAHETYRMRIMRAILWLEEHMNEAVSLDDMAAQAHFSPYHFHRIFRGVAGESVMAYIRRLRLEKAV
HRLAYGSASVTDIAFDAGYEAHEAFSRAFRAQFGMSPSALRRHVRKAGMIPAGVLGESAMTKVVAGFTLESLGLEPEVKV
LAPVRVAFVRHTGPYAQCEAAWKTLCDWAFPQGLVMAQTQFMGICYDDPEVTAPDKIRYDACISVPDNVQAEHPVAIREV
EGGEYVCAVWKGPYTGLTNAYAALCGQWGGRSGREFRAAPSVEVYLNDCTSTPEQELLTEIRMPLMPR

Specific function: Binds to the right arm of the replication origin oriC of the chromosome. Rob binding may influence the formation of the nucleoprotein structure, required for oriC function in the initiation of replication [H]

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 HTH araC/xylS-type DNA-binding domain [H]

Homologues:

Organism=Escherichia coli, GI1790857, Length=120, Percent_Identity=37.5, Blast_Score=86, Evalue=2e-18,
Organism=Escherichia coli, GI1790497, Length=98, Percent_Identity=35.7142857142857, Blast_Score=74, Evalue=2e-14,
Organism=Escherichia coli, GI1790339, Length=113, Percent_Identity=37.1681415929204, Blast_Score=71, Evalue=1e-13,
Organism=Escherichia coli, GI48994918, Length=112, Percent_Identity=33.9285714285714, Blast_Score=62, Evalue=4e-11,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR010499
- InterPro:   IPR009057
- InterPro:   IPR012287
- InterPro:   IPR018062
- InterPro:   IPR020449
- InterPro:   IPR018060
- InterPro:   IPR011256 [H]

Pfam domain/function: PF06445 AraC_E_bind; PF00165 HTH_AraC [H]

EC number: NA

Molecular weight: Translated: 34297; Mature: 34297

Theoretical pI: Translated: 6.73; Mature: 6.73

Prosite motif: PS00041 HTH_ARAC_FAMILY_1 ; PS01124 HTH_ARAC_FAMILY_2

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

2.3 %Cys     (Translated Protein)
4.5 %Met     (Translated Protein)
6.8 %Cys+Met (Translated Protein)
2.3 %Cys     (Mature Protein)
4.5 %Met     (Mature Protein)
6.8 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MLYTAAKGNSIMQEHAHETYRMRIMRAILWLEEHMNEAVSLDDMAAQAHFSPYHFHRIFR
CEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHCCCHHHHHHHHH
GVAGESVMAYIRRLRLEKAVHRLAYGSASVTDIAFDAGYEAHEAFSRAFRAQFGMSPSAL
HCCCHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHCCCHHHHHHHHHHHHHCCCCHHHH
RRHVRKAGMIPAGVLGESAMTKVVAGFTLESLGLEPEVKVLAPVRVAFVRHTGPYAQCEA
HHHHHHHCCCCCHHCCHHHHHHHHHHCHHHHCCCCCCCEEHHHHHEEEECCCCCHHHHHH
AWKTLCDWAFPQGLVMAQTQFMGICYDDPEVTAPDKIRYDACISVPDNVQAEHPVAIREV
HHHHHHHHCCCCCCEEEHHHEEEEEECCCCCCCCCCCCCCEEECCCCCCCCCCCEEEEEE
EGGEYVCAVWKGPYTGLTNAYAALCGQWGGRSGREFRAAPSVEVYLNDCTSTPEQELLTE
CCCCEEEEEECCCCCCHHHHHHHHHHHCCCCCCCCEECCCCEEEEEECCCCCCHHHHHHH
IRMPLMPR
HCCCCCCC
>Mature Secondary Structure
MLYTAAKGNSIMQEHAHETYRMRIMRAILWLEEHMNEAVSLDDMAAQAHFSPYHFHRIFR
CEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHCCCHHHHHHHHH
GVAGESVMAYIRRLRLEKAVHRLAYGSASVTDIAFDAGYEAHEAFSRAFRAQFGMSPSAL
HCCCHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHCCCHHHHHHHHHHHHHCCCCHHHH
RRHVRKAGMIPAGVLGESAMTKVVAGFTLESLGLEPEVKVLAPVRVAFVRHTGPYAQCEA
HHHHHHHCCCCCHHCCHHHHHHHHHHCHHHHCCCCCCCEEHHHHHEEEECCCCCHHHHHH
AWKTLCDWAFPQGLVMAQTQFMGICYDDPEVTAPDKIRYDACISVPDNVQAEHPVAIREV
HHHHHHHHCCCCCCEEEHHHEEEEEECCCCCCCCCCCCCCEEECCCCCCCCCCCEEEEEE
EGGEYVCAVWKGPYTGLTNAYAALCGQWGGRSGREFRAAPSVEVYLNDCTSTPEQELLTE
CCCCEEEEEECCCCCCHHHHHHHHHHHCCCCCCCCEECCCCEEEEEECCCCCCHHHHHHH
IRMPLMPR
HCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: DNA [C]

Specific reaction: Protein + DNA = Protein-DNA [C]

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: 11206551; 11258796 [H]