The gene/protein map for NC_009089 is currently unavailable.
Definition Clostridium difficile 630 chromosome, complete genome.
Accession NC_009089
Length 4,290,252

Click here to switch to the map view.

The map label for this gene is purR [H]

Identifier: 126698356

GI number: 126698356

Start: 946539

End: 947555

Strand: Direct

Name: purR [H]

Synonym: CD0776

Alternate gene names: 126698356

Gene position: 946539-947555 (Clockwise)

Preceding gene: 126698355

Following gene: 126698357

Centisome position: 22.06

GC content: 26.94

Gene sequence:

>1017_bases
ATGGTAACTATTAAAGATATTGCAAGGAATCTAGGTATCAGTTATTCAACTGTTTCTAGGTGCTTAAACAATAATCCTAA
TGTATCTGAAAAAACAAAAAAGAAAGTGGTAGAAGAGGCAAATAGACTAGGGTTCCATTTTAATGTAAATGCAAGAAATT
TAGCAAAAAAAGAAACTAACAGGATAGGGGTAATCTTTTCAAATAATTTTAATCATCAAGATACTAGAAAGTTTTTTAGT
GATATAATGGATAGTTCTATAAATTCTATTGAGACTAATAAATACGATTTTATAATACAGCCTAATAATAACATTAGTGG
TGATAGTAATGTATATAAAATGGTAAATGGACAAATGGTTGACGGATTAGTAATTGTGTCTCAATCAATAAAAAAAGAAG
AGTATGATTTTTTAAAAGACAATAATTTTCCACATGTATTTATATATTTTAAACCATCTTTTATAGGAGAAGTAGATAAT
TTCTTTTGGGACGATAACGTGTATGGAGGTTATATAGCTACCAAGCATTTAATTGACCATGGTCATAAAGATATAATAAC
AGTAACTTCAGATGATAAGAGTTCAAAAATGCATGAAGATAGAACCAAGGGATATTTGAATGCTATGGAAGAAGCAAATT
TAAAGACAGAAGTCATTAAATCTAAAATGGATTTTGAATCTCAAGTTGAATTTTTAGAAAAATACATTGATAAAATAAAA
AAAGCTTCAGCTATATTTGTACAACAAGATGTACCAGCGATTTCTATAATACAAGAGTTAAAAACTACTTATGGTATAAA
TGTACCAGAAGATATTTCCATAATAGGGTATAATAATATTGAATTAATATCATATTTTAGGTCGCATTTATCAACAATAG
ATGACCCAAGAGAGCAAGTTATAAAAAATGGAGTAGATAGTTTAGTAAATATAATAAATAAAAAGAGTACAGAACACATT
CCGAGAAAATTATATCCAAGGTTAATAATACGAAATAGCGTTAAAAGAATAAAGTAG

Upstream 100 bases:

>100_bases
TTATATAAAGAAGCGTTTACATAATTGAAGTTGACAATTATTTACAACATAGTGTAGTATTATATTATCAAAATAAAATG
AAGTGAAGTAGGGGATAAAG

Downstream 100 bases:

>100_bases
TAAGCTTTTAAGTATCAAACGTTTATTAAAAATATTATAGATTATGTGAAGTTTTTTAACAAATAATATAAATAAAAATT
AAAAGGAGTAGGTGTATATA

Product: LacI family transcriptional regulator

Products: NA

Alternate protein names: Pur regulon repressor; Purine nucleotide synthesis repressor [H]

Number of amino acids: Translated: 338; Mature: 338

Protein sequence:

>338_residues
MVTIKDIARNLGISYSTVSRCLNNNPNVSEKTKKKVVEEANRLGFHFNVNARNLAKKETNRIGVIFSNNFNHQDTRKFFS
DIMDSSINSIETNKYDFIIQPNNNISGDSNVYKMVNGQMVDGLVIVSQSIKKEEYDFLKDNNFPHVFIYFKPSFIGEVDN
FFWDDNVYGGYIATKHLIDHGHKDIITVTSDDKSSKMHEDRTKGYLNAMEEANLKTEVIKSKMDFESQVEFLEKYIDKIK
KASAIFVQQDVPAISIIQELKTTYGINVPEDISIIGYNNIELISYFRSHLSTIDDPREQVIKNGVDSLVNIINKKSTEHI
PRKLYPRLIIRNSVKRIK

Sequences:

>Translated_338_residues
MVTIKDIARNLGISYSTVSRCLNNNPNVSEKTKKKVVEEANRLGFHFNVNARNLAKKETNRIGVIFSNNFNHQDTRKFFS
DIMDSSINSIETNKYDFIIQPNNNISGDSNVYKMVNGQMVDGLVIVSQSIKKEEYDFLKDNNFPHVFIYFKPSFIGEVDN
FFWDDNVYGGYIATKHLIDHGHKDIITVTSDDKSSKMHEDRTKGYLNAMEEANLKTEVIKSKMDFESQVEFLEKYIDKIK
KASAIFVQQDVPAISIIQELKTTYGINVPEDISIIGYNNIELISYFRSHLSTIDDPREQVIKNGVDSLVNIINKKSTEHI
PRKLYPRLIIRNSVKRIK
>Mature_338_residues
MVTIKDIARNLGISYSTVSRCLNNNPNVSEKTKKKVVEEANRLGFHFNVNARNLAKKETNRIGVIFSNNFNHQDTRKFFS
DIMDSSINSIETNKYDFIIQPNNNISGDSNVYKMVNGQMVDGLVIVSQSIKKEEYDFLKDNNFPHVFIYFKPSFIGEVDN
FFWDDNVYGGYIATKHLIDHGHKDIITVTSDDKSSKMHEDRTKGYLNAMEEANLKTEVIKSKMDFESQVEFLEKYIDKIK
KASAIFVQQDVPAISIIQELKTTYGINVPEDISIIGYNNIELISYFRSHLSTIDDPREQVIKNGVDSLVNIINKKSTEHI
PRKLYPRLIIRNSVKRIK

Specific function: Is the main repressor of the genes involved in the de novo synthesis of purine nucleotides, regulating purB, purC, purEK, purF, purHD, purL, purMN and guaBA expression. PurR is allosterically activated to bind its cognate DNA by binding the purine corepre

COG id: COG1609

COG function: function code K; Transcriptional regulators

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 HTH lacI-type DNA-binding domain [H]

Homologues:

Organism=Escherichia coli, GI1790194, Length=345, Percent_Identity=27.2463768115942, Blast_Score=130, Evalue=1e-31,
Organism=Escherichia coli, GI1787948, Length=343, Percent_Identity=26.8221574344023, Blast_Score=129, Evalue=4e-31,
Organism=Escherichia coli, GI1790369, Length=345, Percent_Identity=24.0579710144928, Blast_Score=112, Evalue=3e-26,
Organism=Escherichia coli, GI1789202, Length=341, Percent_Identity=26.3929618768328, Blast_Score=110, Evalue=1e-25,
Organism=Escherichia coli, GI1789068, Length=338, Percent_Identity=23.6686390532544, Blast_Score=100, Evalue=1e-22,
Organism=Escherichia coli, GI1788474, Length=341, Percent_Identity=24.0469208211144, Blast_Score=99, Evalue=5e-22,
Organism=Escherichia coli, GI1787580, Length=325, Percent_Identity=23.6923076923077, Blast_Score=91, Evalue=1e-19,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR000843
- InterPro:   IPR010982
- InterPro:   IPR001761 [H]

Pfam domain/function: PF00356 LacI; PF00532 Peripla_BP_1 [H]

EC number: NA

Molecular weight: Translated: 38908; Mature: 38908

Theoretical pI: Translated: 8.74; Mature: 8.74

Prosite motif: PS50932 HTH_LACI_2

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.3 %Cys     (Translated Protein)
2.1 %Met     (Translated Protein)
2.4 %Cys+Met (Translated Protein)
0.3 %Cys     (Mature Protein)
2.1 %Met     (Mature Protein)
2.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MVTIKDIARNLGISYSTVSRCLNNNPNVSEKTKKKVVEEANRLGFHFNVNARNLAKKETN
CCCHHHHHHHCCCCHHHHHHHHCCCCCCCHHHHHHHHHHHHHCCEEEECCHHHHHHHHCC
RIGVIFSNNFNHQDTRKFFSDIMDSSINSIETNKYDFIIQPNNNISGDSNVYKMVNGQMV
EEEEEEECCCCCHHHHHHHHHHHHHHCCCCCCCCEEEEEECCCCCCCCCCHHHHHCCCHH
DGLVIVSQSIKKEEYDFLKDNNFPHVFIYFKPSFIGEVDNFFWDDNVYGGYIATKHLIDH
HHHEEHHHHHHHHHHHHHCCCCCCEEEEEECCHHHHHHHHCEECCCCCCCHHHHHHHHHC
GHKDIITVTSDDKSSKMHEDRTKGYLNAMEEANLKTEVIKSKMDFESQVEFLEKYIDKIK
CCCCEEEEECCCCHHHHHHHHHHHHHHHHHHCCHHHHHHHHHCCHHHHHHHHHHHHHHHH
KASAIFVQQDVPAISIIQELKTTYGINVPEDISIIGYNNIELISYFRSHLSTIDDPREQV
HHHEEEEECCCCHHHHHHHHHHHHCCCCCCCEEEEECCCHHHHHHHHHHHHCCCCHHHHH
IKNGVDSLVNIINKKSTEHIPRKLYPRLIIRNSVKRIK
HHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHCC
>Mature Secondary Structure
MVTIKDIARNLGISYSTVSRCLNNNPNVSEKTKKKVVEEANRLGFHFNVNARNLAKKETN
CCCHHHHHHHCCCCHHHHHHHHCCCCCCCHHHHHHHHHHHHHCCEEEECCHHHHHHHHCC
RIGVIFSNNFNHQDTRKFFSDIMDSSINSIETNKYDFIIQPNNNISGDSNVYKMVNGQMV
EEEEEEECCCCCHHHHHHHHHHHHHHCCCCCCCCEEEEEECCCCCCCCCCHHHHHCCCHH
DGLVIVSQSIKKEEYDFLKDNNFPHVFIYFKPSFIGEVDNFFWDDNVYGGYIATKHLIDH
HHHEEHHHHHHHHHHHHHCCCCCCEEEEEECCHHHHHHHHCEECCCCCCCHHHHHHHHHC
GHKDIITVTSDDKSSKMHEDRTKGYLNAMEEANLKTEVIKSKMDFESQVEFLEKYIDKIK
CCCCEEEEECCCCHHHHHHHHHHHHHHHHHHCCHHHHHHHHHCCHHHHHHHHHHHHHHHH
KASAIFVQQDVPAISIIQELKTTYGINVPEDISIIGYNNIELISYFRSHLSTIDDPREQV
HHHEEEEECCCCHHHHHHHHHHHHCCCCCCCEEEEECCCHHHHHHHHHHHHCCCCHHHHH
IKNGVDSLVNIINKKSTEHIPRKLYPRLIIRNSVKRIK
HHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: NA