| Definition | Clostridium difficile 630 chromosome, complete genome. |
|---|---|
| Accession | NC_009089 |
| Length | 4,290,252 |
Click here to switch to the map view.
The map label for this gene is purR [H]
Identifier: 126698356
GI number: 126698356
Start: 946539
End: 947555
Strand: Direct
Name: purR [H]
Synonym: CD0776
Alternate gene names: 126698356
Gene position: 946539-947555 (Clockwise)
Preceding gene: 126698355
Following gene: 126698357
Centisome position: 22.06
GC content: 26.94
Gene sequence:
>1017_bases ATGGTAACTATTAAAGATATTGCAAGGAATCTAGGTATCAGTTATTCAACTGTTTCTAGGTGCTTAAACAATAATCCTAA TGTATCTGAAAAAACAAAAAAGAAAGTGGTAGAAGAGGCAAATAGACTAGGGTTCCATTTTAATGTAAATGCAAGAAATT TAGCAAAAAAAGAAACTAACAGGATAGGGGTAATCTTTTCAAATAATTTTAATCATCAAGATACTAGAAAGTTTTTTAGT GATATAATGGATAGTTCTATAAATTCTATTGAGACTAATAAATACGATTTTATAATACAGCCTAATAATAACATTAGTGG TGATAGTAATGTATATAAAATGGTAAATGGACAAATGGTTGACGGATTAGTAATTGTGTCTCAATCAATAAAAAAAGAAG AGTATGATTTTTTAAAAGACAATAATTTTCCACATGTATTTATATATTTTAAACCATCTTTTATAGGAGAAGTAGATAAT TTCTTTTGGGACGATAACGTGTATGGAGGTTATATAGCTACCAAGCATTTAATTGACCATGGTCATAAAGATATAATAAC AGTAACTTCAGATGATAAGAGTTCAAAAATGCATGAAGATAGAACCAAGGGATATTTGAATGCTATGGAAGAAGCAAATT TAAAGACAGAAGTCATTAAATCTAAAATGGATTTTGAATCTCAAGTTGAATTTTTAGAAAAATACATTGATAAAATAAAA AAAGCTTCAGCTATATTTGTACAACAAGATGTACCAGCGATTTCTATAATACAAGAGTTAAAAACTACTTATGGTATAAA TGTACCAGAAGATATTTCCATAATAGGGTATAATAATATTGAATTAATATCATATTTTAGGTCGCATTTATCAACAATAG ATGACCCAAGAGAGCAAGTTATAAAAAATGGAGTAGATAGTTTAGTAAATATAATAAATAAAAAGAGTACAGAACACATT CCGAGAAAATTATATCCAAGGTTAATAATACGAAATAGCGTTAAAAGAATAAAGTAG
Upstream 100 bases:
>100_bases TTATATAAAGAAGCGTTTACATAATTGAAGTTGACAATTATTTACAACATAGTGTAGTATTATATTATCAAAATAAAATG AAGTGAAGTAGGGGATAAAG
Downstream 100 bases:
>100_bases TAAGCTTTTAAGTATCAAACGTTTATTAAAAATATTATAGATTATGTGAAGTTTTTTAACAAATAATATAAATAAAAATT AAAAGGAGTAGGTGTATATA
Product: LacI family transcriptional regulator
Products: NA
Alternate protein names: Pur regulon repressor; Purine nucleotide synthesis repressor [H]
Number of amino acids: Translated: 338; Mature: 338
Protein sequence:
>338_residues MVTIKDIARNLGISYSTVSRCLNNNPNVSEKTKKKVVEEANRLGFHFNVNARNLAKKETNRIGVIFSNNFNHQDTRKFFS DIMDSSINSIETNKYDFIIQPNNNISGDSNVYKMVNGQMVDGLVIVSQSIKKEEYDFLKDNNFPHVFIYFKPSFIGEVDN FFWDDNVYGGYIATKHLIDHGHKDIITVTSDDKSSKMHEDRTKGYLNAMEEANLKTEVIKSKMDFESQVEFLEKYIDKIK KASAIFVQQDVPAISIIQELKTTYGINVPEDISIIGYNNIELISYFRSHLSTIDDPREQVIKNGVDSLVNIINKKSTEHI PRKLYPRLIIRNSVKRIK
Sequences:
>Translated_338_residues MVTIKDIARNLGISYSTVSRCLNNNPNVSEKTKKKVVEEANRLGFHFNVNARNLAKKETNRIGVIFSNNFNHQDTRKFFS DIMDSSINSIETNKYDFIIQPNNNISGDSNVYKMVNGQMVDGLVIVSQSIKKEEYDFLKDNNFPHVFIYFKPSFIGEVDN FFWDDNVYGGYIATKHLIDHGHKDIITVTSDDKSSKMHEDRTKGYLNAMEEANLKTEVIKSKMDFESQVEFLEKYIDKIK KASAIFVQQDVPAISIIQELKTTYGINVPEDISIIGYNNIELISYFRSHLSTIDDPREQVIKNGVDSLVNIINKKSTEHI PRKLYPRLIIRNSVKRIK >Mature_338_residues MVTIKDIARNLGISYSTVSRCLNNNPNVSEKTKKKVVEEANRLGFHFNVNARNLAKKETNRIGVIFSNNFNHQDTRKFFS DIMDSSINSIETNKYDFIIQPNNNISGDSNVYKMVNGQMVDGLVIVSQSIKKEEYDFLKDNNFPHVFIYFKPSFIGEVDN FFWDDNVYGGYIATKHLIDHGHKDIITVTSDDKSSKMHEDRTKGYLNAMEEANLKTEVIKSKMDFESQVEFLEKYIDKIK KASAIFVQQDVPAISIIQELKTTYGINVPEDISIIGYNNIELISYFRSHLSTIDDPREQVIKNGVDSLVNIINKKSTEHI PRKLYPRLIIRNSVKRIK
Specific function: Is the main repressor of the genes involved in the de novo synthesis of purine nucleotides, regulating purB, purC, purEK, purF, purHD, purL, purMN and guaBA expression. PurR is allosterically activated to bind its cognate DNA by binding the purine corepre
COG id: COG1609
COG function: function code K; Transcriptional regulators
Gene ontology:
Cell location: Cytoplasmic
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 1 HTH lacI-type DNA-binding domain [H]
Homologues:
Organism=Escherichia coli, GI1790194, Length=345, Percent_Identity=27.2463768115942, Blast_Score=130, Evalue=1e-31, Organism=Escherichia coli, GI1787948, Length=343, Percent_Identity=26.8221574344023, Blast_Score=129, Evalue=4e-31, Organism=Escherichia coli, GI1790369, Length=345, Percent_Identity=24.0579710144928, Blast_Score=112, Evalue=3e-26, Organism=Escherichia coli, GI1789202, Length=341, Percent_Identity=26.3929618768328, Blast_Score=110, Evalue=1e-25, Organism=Escherichia coli, GI1789068, Length=338, Percent_Identity=23.6686390532544, Blast_Score=100, Evalue=1e-22, Organism=Escherichia coli, GI1788474, Length=341, Percent_Identity=24.0469208211144, Blast_Score=99, Evalue=5e-22, Organism=Escherichia coli, GI1787580, Length=325, Percent_Identity=23.6923076923077, Blast_Score=91, Evalue=1e-19,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR000843 - InterPro: IPR010982 - InterPro: IPR001761 [H]
Pfam domain/function: PF00356 LacI; PF00532 Peripla_BP_1 [H]
EC number: NA
Molecular weight: Translated: 38908; Mature: 38908
Theoretical pI: Translated: 8.74; Mature: 8.74
Prosite motif: PS50932 HTH_LACI_2
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.3 %Cys (Translated Protein) 2.1 %Met (Translated Protein) 2.4 %Cys+Met (Translated Protein) 0.3 %Cys (Mature Protein) 2.1 %Met (Mature Protein) 2.4 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MVTIKDIARNLGISYSTVSRCLNNNPNVSEKTKKKVVEEANRLGFHFNVNARNLAKKETN CCCHHHHHHHCCCCHHHHHHHHCCCCCCCHHHHHHHHHHHHHCCEEEECCHHHHHHHHCC RIGVIFSNNFNHQDTRKFFSDIMDSSINSIETNKYDFIIQPNNNISGDSNVYKMVNGQMV EEEEEEECCCCCHHHHHHHHHHHHHHCCCCCCCCEEEEEECCCCCCCCCCHHHHHCCCHH DGLVIVSQSIKKEEYDFLKDNNFPHVFIYFKPSFIGEVDNFFWDDNVYGGYIATKHLIDH HHHEEHHHHHHHHHHHHHCCCCCCEEEEEECCHHHHHHHHCEECCCCCCCHHHHHHHHHC GHKDIITVTSDDKSSKMHEDRTKGYLNAMEEANLKTEVIKSKMDFESQVEFLEKYIDKIK CCCCEEEEECCCCHHHHHHHHHHHHHHHHHHCCHHHHHHHHHCCHHHHHHHHHHHHHHHH KASAIFVQQDVPAISIIQELKTTYGINVPEDISIIGYNNIELISYFRSHLSTIDDPREQV HHHEEEEECCCCHHHHHHHHHHHHCCCCCCCEEEEECCCHHHHHHHHHHHHCCCCHHHHH IKNGVDSLVNIINKKSTEHIPRKLYPRLIIRNSVKRIK HHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHCC >Mature Secondary Structure MVTIKDIARNLGISYSTVSRCLNNNPNVSEKTKKKVVEEANRLGFHFNVNARNLAKKETN CCCHHHHHHHCCCCHHHHHHHHCCCCCCCHHHHHHHHHHHHHCCEEEECCHHHHHHHHCC RIGVIFSNNFNHQDTRKFFSDIMDSSINSIETNKYDFIIQPNNNISGDSNVYKMVNGQMV EEEEEEECCCCCHHHHHHHHHHHHHHCCCCCCCCEEEEEECCCCCCCCCCHHHHHCCCHH DGLVIVSQSIKKEEYDFLKDNNFPHVFIYFKPSFIGEVDNFFWDDNVYGGYIATKHLIDH HHHEEHHHHHHHHHHHHHCCCCCCEEEEEECCHHHHHHHHCEECCCCCCCHHHHHHHHHC GHKDIITVTSDDKSSKMHEDRTKGYLNAMEEANLKTEVIKSKMDFESQVEFLEKYIDKIK CCCCEEEEECCCCHHHHHHHHHHHHHHHHHHCCHHHHHHHHHCCHHHHHHHHHHHHHHHH KASAIFVQQDVPAISIIQELKTTYGINVPEDISIIGYNNIELISYFRSHLSTIDDPREQV HHHEEEEECCCCHHHHHHHHHHHHCCCCCCCEEEEECCCHHHHHHHHHHHHCCCCHHHHH IKNGVDSLVNIINKKSTEHIPRKLYPRLIIRNSVKRIK HHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 10.0
TargetDB status: NA
Availability: NA
References: NA