| Definition | Desulfovibrio desulfuricans subsp. desulfuricans str. G20 chromosome, complete genome. |
|---|---|
| Accession | NC_007519 |
| Length | 3,730,232 |
Click here to switch to the map view.
The map label for this gene is rob [H]
Identifier: 78358741
GI number: 78358741
Start: 3664296
End: 3665222
Strand: Reverse
Name: rob [H]
Synonym: Dde_3702
Alternate gene names: 78358741
Gene position: 3665222-3664296 (Counterclockwise)
Preceding gene: 78358755
Following gene: 78358721
Centisome position: 98.26
GC content: 58.04
Gene sequence:
>927_bases ATGCTGTATACCGCTGCAAAGGGAAACAGCATTATGCAGGAACACGCGCACGAGACATACCGCATGCGTATCATGCGGGC CATACTGTGGCTGGAAGAGCATATGAACGAGGCTGTGAGTCTTGATGATATGGCCGCGCAGGCTCATTTTTCACCGTATC ACTTCCACCGGATATTCCGCGGAGTGGCGGGAGAATCGGTGATGGCCTACATACGGCGGCTGAGGCTGGAAAAGGCGGTG CACCGTCTGGCTTACGGCAGCGCTTCAGTGACCGATATCGCCTTTGATGCCGGATACGAAGCGCATGAAGCATTCAGCAG AGCTTTCAGGGCACAGTTCGGCATGTCTCCCTCCGCGCTGCGCAGGCATGTGCGAAAAGCGGGAATGATTCCCGCCGGAG TTCTGGGAGAATCCGCCATGACCAAAGTGGTAGCCGGTTTCACGTTGGAAAGTCTGGGGCTGGAGCCTGAAGTGAAGGTT CTGGCTCCTGTCCGGGTGGCCTTTGTCAGACACACCGGCCCGTATGCGCAATGCGAGGCCGCCTGGAAAACCCTGTGCGA CTGGGCGTTTCCGCAAGGGCTGGTGATGGCACAGACACAGTTTATGGGCATCTGCTACGATGACCCCGAAGTGACCGCAC CGGATAAAATCCGTTACGATGCCTGCATATCGGTGCCGGATAATGTGCAGGCTGAGCATCCTGTGGCCATACGCGAGGTG GAAGGCGGCGAATATGTATGCGCCGTGTGGAAAGGCCCCTACACAGGGTTGACCAATGCCTATGCCGCGTTGTGCGGGCA ATGGGGCGGCCGTTCCGGCAGAGAATTCCGCGCAGCGCCCAGTGTCGAGGTGTATCTTAATGACTGCACATCAACGCCGG AACAGGAGTTGCTGACGGAAATCCGCATGCCGCTGATGCCGCGCTGA
Upstream 100 bases:
>100_bases GGCTGTCAAGCGGCAGCGGCAGCCCCCCGCGGGGAAGTAAGCTCTGCTGTCGTGTCCCGCGGGGACATTGCGCAAAAAAA GTCATGTGGGAGCACCGTAC
Downstream 100 bases:
>100_bases GGGCGGCGGCTGTGAACAGAATATGCCCGCGGTTCTGCCGCGGGCTTTTTTACGGCTGGTCAGGGGGGGGGCTGGGGCTG GTCAGGGGTTGGTCAGGGGT
Product: AraC type transcriptional regulator
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 308; Mature: 308
Protein sequence:
>308_residues MLYTAAKGNSIMQEHAHETYRMRIMRAILWLEEHMNEAVSLDDMAAQAHFSPYHFHRIFRGVAGESVMAYIRRLRLEKAV HRLAYGSASVTDIAFDAGYEAHEAFSRAFRAQFGMSPSALRRHVRKAGMIPAGVLGESAMTKVVAGFTLESLGLEPEVKV LAPVRVAFVRHTGPYAQCEAAWKTLCDWAFPQGLVMAQTQFMGICYDDPEVTAPDKIRYDACISVPDNVQAEHPVAIREV EGGEYVCAVWKGPYTGLTNAYAALCGQWGGRSGREFRAAPSVEVYLNDCTSTPEQELLTEIRMPLMPR
Sequences:
>Translated_308_residues MLYTAAKGNSIMQEHAHETYRMRIMRAILWLEEHMNEAVSLDDMAAQAHFSPYHFHRIFRGVAGESVMAYIRRLRLEKAV HRLAYGSASVTDIAFDAGYEAHEAFSRAFRAQFGMSPSALRRHVRKAGMIPAGVLGESAMTKVVAGFTLESLGLEPEVKV LAPVRVAFVRHTGPYAQCEAAWKTLCDWAFPQGLVMAQTQFMGICYDDPEVTAPDKIRYDACISVPDNVQAEHPVAIREV EGGEYVCAVWKGPYTGLTNAYAALCGQWGGRSGREFRAAPSVEVYLNDCTSTPEQELLTEIRMPLMPR >Mature_308_residues MLYTAAKGNSIMQEHAHETYRMRIMRAILWLEEHMNEAVSLDDMAAQAHFSPYHFHRIFRGVAGESVMAYIRRLRLEKAV HRLAYGSASVTDIAFDAGYEAHEAFSRAFRAQFGMSPSALRRHVRKAGMIPAGVLGESAMTKVVAGFTLESLGLEPEVKV LAPVRVAFVRHTGPYAQCEAAWKTLCDWAFPQGLVMAQTQFMGICYDDPEVTAPDKIRYDACISVPDNVQAEHPVAIREV EGGEYVCAVWKGPYTGLTNAYAALCGQWGGRSGREFRAAPSVEVYLNDCTSTPEQELLTEIRMPLMPR
Specific function: Binds to the right arm of the replication origin oriC of the chromosome. Rob binding may influence the formation of the nucleoprotein structure, required for oriC function in the initiation of replication [H]
COG id: NA
COG function: NA
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 1 HTH araC/xylS-type DNA-binding domain [H]
Homologues:
Organism=Escherichia coli, GI1790857, Length=120, Percent_Identity=37.5, Blast_Score=86, Evalue=2e-18, Organism=Escherichia coli, GI1790497, Length=98, Percent_Identity=35.7142857142857, Blast_Score=74, Evalue=2e-14, Organism=Escherichia coli, GI1790339, Length=113, Percent_Identity=37.1681415929204, Blast_Score=71, Evalue=1e-13, Organism=Escherichia coli, GI48994918, Length=112, Percent_Identity=33.9285714285714, Blast_Score=62, Evalue=4e-11,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR010499 - InterPro: IPR009057 - InterPro: IPR012287 - InterPro: IPR018062 - InterPro: IPR020449 - InterPro: IPR018060 - InterPro: IPR011256 [H]
Pfam domain/function: PF06445 AraC_E_bind; PF00165 HTH_AraC [H]
EC number: NA
Molecular weight: Translated: 34297; Mature: 34297
Theoretical pI: Translated: 6.73; Mature: 6.73
Prosite motif: PS00041 HTH_ARAC_FAMILY_1 ; PS01124 HTH_ARAC_FAMILY_2
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
2.3 %Cys (Translated Protein) 4.5 %Met (Translated Protein) 6.8 %Cys+Met (Translated Protein) 2.3 %Cys (Mature Protein) 4.5 %Met (Mature Protein) 6.8 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MLYTAAKGNSIMQEHAHETYRMRIMRAILWLEEHMNEAVSLDDMAAQAHFSPYHFHRIFR CEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHCCCHHHHHHHHH GVAGESVMAYIRRLRLEKAVHRLAYGSASVTDIAFDAGYEAHEAFSRAFRAQFGMSPSAL HCCCHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHCCCHHHHHHHHHHHHHCCCCHHHH RRHVRKAGMIPAGVLGESAMTKVVAGFTLESLGLEPEVKVLAPVRVAFVRHTGPYAQCEA HHHHHHHCCCCCHHCCHHHHHHHHHHCHHHHCCCCCCCEEHHHHHEEEECCCCCHHHHHH AWKTLCDWAFPQGLVMAQTQFMGICYDDPEVTAPDKIRYDACISVPDNVQAEHPVAIREV HHHHHHHHCCCCCCEEEHHHEEEEEECCCCCCCCCCCCCCEEECCCCCCCCCCCEEEEEE EGGEYVCAVWKGPYTGLTNAYAALCGQWGGRSGREFRAAPSVEVYLNDCTSTPEQELLTE CCCCEEEEEECCCCCCHHHHHHHHHHHCCCCCCCCEECCCCEEEEEECCCCCCHHHHHHH IRMPLMPR HCCCCCCC >Mature Secondary Structure MLYTAAKGNSIMQEHAHETYRMRIMRAILWLEEHMNEAVSLDDMAAQAHFSPYHFHRIFR CEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHCCCHHHHHHHHH GVAGESVMAYIRRLRLEKAVHRLAYGSASVTDIAFDAGYEAHEAFSRAFRAQFGMSPSAL HCCCHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHCCCHHHHHHHHHHHHHCCCCHHHH RRHVRKAGMIPAGVLGESAMTKVVAGFTLESLGLEPEVKVLAPVRVAFVRHTGPYAQCEA HHHHHHHCCCCCHHCCHHHHHHHHHHCHHHHCCCCCCCEEHHHHHEEEECCCCCHHHHHH AWKTLCDWAFPQGLVMAQTQFMGICYDDPEVTAPDKIRYDACISVPDNVQAEHPVAIREV HHHHHHHHCCCCCCEEEHHHEEEEEECCCCCCCCCCCCCCEEECCCCCCCCCCCEEEEEE EGGEYVCAVWKGPYTGLTNAYAALCGQWGGRSGREFRAAPSVEVYLNDCTSTPEQELLTE CCCCEEEEEECCCCCCHHHHHHHHHHHCCCCCCCCEECCCCEEEEEECCCCCCHHHHHHH IRMPLMPR HCCCCCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: DNA [C]
Specific reaction: Protein + DNA = Protein-DNA [C]
General reaction: NA
Inhibitor: NA
Structure determination priority: 10.0
TargetDB status: NA
Availability: NA
References: 11206551; 11258796 [H]