Definition Clostridium botulinum B str. Eklund 17B, complete genome.
Accession NC_010674
Length 3,800,327

Click here to switch to the map view.

The map label for this gene is purR [H]

Identifier: 187935729

GI number: 187935729

Start: 2155180

End: 2156241

Strand: Reverse

Name: purR [H]

Synonym: CLL_A2060

Alternate gene names: 187935729

Gene position: 2156241-2155180 (Counterclockwise)

Preceding gene: 187934817

Following gene: 187932763

Centisome position: 56.74

GC content: 27.12

Gene sequence:

>1062_bases
ATGGGTAAAGTAACAATGAAAGATATAGCTGCAAAGTTAAATATATCAATAAATGCTGTATCACTGGCGTTAAATGGTAA
ACCAGGAGTCAGTGAAGAAACAAAAAAATTAGTACTAGATGTAGCAGAGAAAATTGGTTATTTGGACAGATCACCTAAAT
TTATCCAATCATTTGCAAGTAAAAATATTTGTGCACTTATAAAACAATCACATTTTGAAGATAGTACATTTTACTCAAAA
ATACTAATGAGCATAGTAGAAGAGGCCAGAAAAAAAGGTTATGATGTTATAACTTGTATAGTAAATGAAGATGAACAGAA
CATTCCAAGTTGTATTGAAAGTAAAAAAGTATGTGGAATAATTATAATATCAGCAATAGATGATGATTATCTAATAAAAC
TTAAAGAATTTGAATTACCTGTTGTACTAGTAGATCACGCATCGTTATTAGAAAATACGGATAGTATTTTAACAAATAAT
AAACTTGGTAGTTTTAAAATTACAAAATTACTTTTAGATAAAGGATATACAAAAATAGGATTCTTTGGAGACTTAGAATA
TTCGTTAAGTATTAAAGAAAGATTTTTTGGGTATCAAGAAGCTATAAAGAAATTTATCAAGTTTGATAATAAAGATGGAA
TTACAGATTTTATAAATGATTATTCAATATTAAGTGATTTAGAAAGTTACATTATAAATCAGGATTCAGAAGGCATACAA
AAGAAAATATCACAAATGGATAATATACCAGAAGCCTTTGTATGTTCAAATGACAATGCTGCAATTATGTTAATTACTTC
ACTAAAGGAATTAGGATATGAAATACCAAAGGATATATCAGTAGTTGGTTTTGATGATATTATATTAAGTTCACTTGTAA
TGCCTAAGGTTACTACAGTAAGAGTACAAAAAGAACTTATGGGCAAAAATGCTGTGAATAGATTATTATGGAGAATTGAT
CATAAGGATGCTCCTAATGAAGATATAGTAATGGGTGTTGATATTGTTGAAAGAGATTCAGTTGGAATAAAAAATATTAT
GGAGAATGAACAAAAGAATTAA

Upstream 100 bases:

>100_bases
TAGAGGACATATTTGCTTTAATGGATAAATAATACATGAGGCTGTTAATTAGTAATATTAATTGATAGCCTTTAGAGTAT
ATTAGAAATAGGAGATTATA

Downstream 100 bases:

>100_bases
TAAAGAGAGCGAGATGAAAGATATGAAAACTTGTGAAATATTATTAGCGGAATATTTAAAGTCAGAATCTAAAATATATG
GTGTAGAAAAAATAAACTTT

Product: transcriptional regulator

Products: NA

Alternate protein names: Pur regulon repressor; Purine nucleotide synthesis repressor [H]

Number of amino acids: Translated: 353; Mature: 352

Protein sequence:

>353_residues
MGKVTMKDIAAKLNISINAVSLALNGKPGVSEETKKLVLDVAEKIGYLDRSPKFIQSFASKNICALIKQSHFEDSTFYSK
ILMSIVEEARKKGYDVITCIVNEDEQNIPSCIESKKVCGIIIISAIDDDYLIKLKEFELPVVLVDHASLLENTDSILTNN
KLGSFKITKLLLDKGYTKIGFFGDLEYSLSIKERFFGYQEAIKKFIKFDNKDGITDFINDYSILSDLESYIINQDSEGIQ
KKISQMDNIPEAFVCSNDNAAIMLITSLKELGYEIPKDISVVGFDDIILSSLVMPKVTTVRVQKELMGKNAVNRLLWRID
HKDAPNEDIVMGVDIVERDSVGIKNIMENEQKN

Sequences:

>Translated_353_residues
MGKVTMKDIAAKLNISINAVSLALNGKPGVSEETKKLVLDVAEKIGYLDRSPKFIQSFASKNICALIKQSHFEDSTFYSK
ILMSIVEEARKKGYDVITCIVNEDEQNIPSCIESKKVCGIIIISAIDDDYLIKLKEFELPVVLVDHASLLENTDSILTNN
KLGSFKITKLLLDKGYTKIGFFGDLEYSLSIKERFFGYQEAIKKFIKFDNKDGITDFINDYSILSDLESYIINQDSEGIQ
KKISQMDNIPEAFVCSNDNAAIMLITSLKELGYEIPKDISVVGFDDIILSSLVMPKVTTVRVQKELMGKNAVNRLLWRID
HKDAPNEDIVMGVDIVERDSVGIKNIMENEQKN
>Mature_352_residues
GKVTMKDIAAKLNISINAVSLALNGKPGVSEETKKLVLDVAEKIGYLDRSPKFIQSFASKNICALIKQSHFEDSTFYSKI
LMSIVEEARKKGYDVITCIVNEDEQNIPSCIESKKVCGIIIISAIDDDYLIKLKEFELPVVLVDHASLLENTDSILTNNK
LGSFKITKLLLDKGYTKIGFFGDLEYSLSIKERFFGYQEAIKKFIKFDNKDGITDFINDYSILSDLESYIINQDSEGIQK
KISQMDNIPEAFVCSNDNAAIMLITSLKELGYEIPKDISVVGFDDIILSSLVMPKVTTVRVQKELMGKNAVNRLLWRIDH
KDAPNEDIVMGVDIVERDSVGIKNIMENEQKN

Specific function: Is the main repressor of the genes involved in the de novo synthesis of purine nucleotides, regulating purB, purC, purEK, purF, purHD, purL, purMN and guaBA expression. PurR is allosterically activated to bind its cognate DNA by binding the purine corepre

COG id: COG1609

COG function: function code K; Transcriptional regulators

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 HTH lacI-type DNA-binding domain [H]

Homologues:

Organism=Escherichia coli, GI1790194, Length=348, Percent_Identity=27.2988505747126, Blast_Score=110, Evalue=2e-25,
Organism=Escherichia coli, GI1787948, Length=353, Percent_Identity=24.6458923512748, Blast_Score=105, Evalue=4e-24,
Organism=Escherichia coli, GI1789068, Length=353, Percent_Identity=24.6458923512748, Blast_Score=93, Evalue=3e-20,
Organism=Escherichia coli, GI1789456, Length=318, Percent_Identity=25.4716981132075, Blast_Score=92, Evalue=3e-20,
Organism=Escherichia coli, GI1790369, Length=348, Percent_Identity=24.1379310344828, Blast_Score=89, Evalue=5e-19,
Organism=Escherichia coli, GI1786540, Length=353, Percent_Identity=23.7960339943343, Blast_Score=86, Evalue=4e-18,
Organism=Escherichia coli, GI1787906, Length=349, Percent_Identity=22.6361031518625, Blast_Score=83, Evalue=2e-17,
Organism=Escherichia coli, GI1787580, Length=333, Percent_Identity=23.7237237237237, Blast_Score=80, Evalue=2e-16,
Organism=Escherichia coli, GI1789202, Length=359, Percent_Identity=23.6768802228412, Blast_Score=80, Evalue=3e-16,
Organism=Escherichia coli, GI48994940, Length=330, Percent_Identity=21.5151515151515, Blast_Score=64, Evalue=1e-11,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR000843
- InterPro:   IPR010982
- InterPro:   IPR001761 [H]

Pfam domain/function: PF00356 LacI; PF00532 Peripla_BP_1 [H]

EC number: NA

Molecular weight: Translated: 39648; Mature: 39517

Theoretical pI: Translated: 4.83; Mature: 4.83

Prosite motif: PS50932 HTH_LACI_2

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.4 %Cys     (Translated Protein)
2.5 %Met     (Translated Protein)
4.0 %Cys+Met (Translated Protein)
1.4 %Cys     (Mature Protein)
2.3 %Met     (Mature Protein)
3.7 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MGKVTMKDIAAKLNISINAVSLALNGKPGVSEETKKLVLDVAEKIGYLDRSPKFIQSFAS
CCCCCHHHHHHHHEEEEEEEEEEECCCCCCCHHHHHHHHHHHHHCCCCCCCHHHHHHHHC
KNICALIKQSHFEDSTFYSKILMSIVEEARKKGYDVITCIVNEDEQNIPSCIESKKVCGI
CCHHHHHHHHCCCCHHHHHHHHHHHHHHHHHCCCEEEEEEECCCCCCCHHHHHCCCCEEE
IIISAIDDDYLIKLKEFELPVVLVDHASLLENTDSILTNNKLGSFKITKLLLDKGYTKIG
EEEEECCCCEEEEEEECCCCEEEECCHHHHHCCHHHHCCCCCCCHHHHHHHHHCCCCEEE
FFGDLEYSLSIKERFFGYQEAIKKFIKFDNKDGITDFINDYSILSDLESYIINQDSEGIQ
EEECCEEEEEHHHHHCCHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHCCCCHHHHH
KKISQMDNIPEAFVCSNDNAAIMLITSLKELGYEIPKDISVVGFDDIILSSLVMPKVTTV
HHHHHHCCCCCEEEECCCCCEEEEEEHHHHCCCCCCCCCEEECHHHHHHHHHHCCCHHHH
RVQKELMGKNAVNRLLWRIDHKDAPNEDIVMGVDIVERDSVGIKNIMENEQKN
HHHHHHHCHHHHHHHHHHCCCCCCCCCCEEEECEEEECCCCCHHHHHHCCCCC
>Mature Secondary Structure 
GKVTMKDIAAKLNISINAVSLALNGKPGVSEETKKLVLDVAEKIGYLDRSPKFIQSFAS
CCCCHHHHHHHHEEEEEEEEEEECCCCCCCHHHHHHHHHHHHHCCCCCCCHHHHHHHHC
KNICALIKQSHFEDSTFYSKILMSIVEEARKKGYDVITCIVNEDEQNIPSCIESKKVCGI
CCHHHHHHHHCCCCHHHHHHHHHHHHHHHHHCCCEEEEEEECCCCCCCHHHHHCCCCEEE
IIISAIDDDYLIKLKEFELPVVLVDHASLLENTDSILTNNKLGSFKITKLLLDKGYTKIG
EEEEECCCCEEEEEEECCCCEEEECCHHHHHCCHHHHCCCCCCCHHHHHHHHHCCCCEEE
FFGDLEYSLSIKERFFGYQEAIKKFIKFDNKDGITDFINDYSILSDLESYIINQDSEGIQ
EEECCEEEEEHHHHHCCHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHCCCCHHHHH
KKISQMDNIPEAFVCSNDNAAIMLITSLKELGYEIPKDISVVGFDDIILSSLVMPKVTTV
HHHHHHCCCCCEEEECCCCCEEEEEEHHHHCCCCCCCCCEEECHHHHHHHHHHCCCHHHH
RVQKELMGKNAVNRLLWRIDHKDAPNEDIVMGVDIVERDSVGIKNIMENEQKN
HHHHHHHCHHHHHHHHHHCCCCCCCCCCEEEECEEEECCCCCHHHHHHCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: NA