Definition Agrobacterium tumefaciens str. C58 plasmid Ti, complete sequence.
Accession NC_003065
Length 214,233

Click here to switch to the map view.

The map label for this gene is accR

Identifier: 159161984

GI number: 159161984

Start: 157464

End: 158240

Strand: Direct

Name: accR

Synonym: Atu6138

Alternate gene names: 159161984

Gene position: 157464-158240 (Clockwise)

Preceding gene: 16119949

Following gene: 16119957

Centisome position: 73.5

GC content: 57.27

Gene sequence:

>777_bases
TTGGTGTTCAACTCAACTCAGGACCGCCAGGCGAAAATCGTTGAGCTTTTGCGCGATGAGCAGTTTTTGGCTATCGGCAG
ATTGACGGAGCACTTCCAGATTTCGGTGGCCACTGCGAGGCGCGACTTGAGCGAACTCCACGAGGCCGGACTCTTGCGTC
GAACTCACGGCGGTGCGGTCAGCGTCACGCAGGTTACACAGGACAAGCCGAACGCTGCCCGCGCCGTCTGGAATCGGGCG
GAGAAGGCGGCCATAGCCGGAGTCGTTGCCGGTATGATCGTCGAGGGTGACACGGTTCTTCTGGACGCCGGTACAACTGC
GCTGGAAGTTGCCAAGAAGCTCGCTGACCGCAGAAACCTCACCTTCATCTCGAATGGTCTCGACATTGTCGAGGAATTGA
CGAGAGGGGAGGGCAAAAGCATCTATTCGGTCGGGGGCGAGTATACCGAAACGAACCGCTCCTTCCGCGGCCCTTTGGCG
GAGCAGTTTATCCGCCAGTTCAATGTCGACAAACTCATTCTCAACGCGGCGTCGATCGATGTTGATCGCGGATTGATCTG
TACGTCGTCGCCCGTGAACGCGAGTGTCGCTCGCGCCATGATCGAAGTTTCGAGCCGCGTGATCGTCGTCGCGGATCATT
CGAAATTCACAAAATCGAGCCTCTCGGTGACGGCCAGGATCGAGGATGTCGGCGTGATCGTCACCGACTCTGGAACCCGA
ACCATCATTGAGACAATACCGGAAAAGCTGCGGAAGAAGTTCGTTGTTGCGAACTAG

Upstream 100 bases:

>100_bases
GTTGCGTTGCAACAAAACTGTCACCAAACTTTCATTTGACGAAGAACGATTACGCTCATAGTATGAGCGATATAGACCAT
TTCTTGTTGGAAGGGAAGCG

Downstream 100 bases:

>100_bases
GTTCGACGGCCGCGCGCGAATTAAAGCCTCATTCAACAGAGCTGGGAGGAAAACCACATGCTTAAGACCAATCGCAGGAA
TTTTATGATGGGCACCGCGG

Product: repressor of the acc and Arc operons

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 258; Mature: 258

Protein sequence:

>258_residues
MVFNSTQDRQAKIVELLRDEQFLAIGRLTEHFQISVATARRDLSELHEAGLLRRTHGGAVSVTQVTQDKPNAARAVWNRA
EKAAIAGVVAGMIVEGDTVLLDAGTTALEVAKKLADRRNLTFISNGLDIVEELTRGEGKSIYSVGGEYTETNRSFRGPLA
EQFIRQFNVDKLILNAASIDVDRGLICTSSPVNASVARAMIEVSSRVIVVADHSKFTKSSLSVTARIEDVGVIVTDSGTR
TIIETIPEKLRKKFVVAN

Sequences:

>Translated_258_residues
MVFNSTQDRQAKIVELLRDEQFLAIGRLTEHFQISVATARRDLSELHEAGLLRRTHGGAVSVTQVTQDKPNAARAVWNRA
EKAAIAGVVAGMIVEGDTVLLDAGTTALEVAKKLADRRNLTFISNGLDIVEELTRGEGKSIYSVGGEYTETNRSFRGPLA
EQFIRQFNVDKLILNAASIDVDRGLICTSSPVNASVARAMIEVSSRVIVVADHSKFTKSSLSVTARIEDVGVIVTDSGTR
TIIETIPEKLRKKFVVAN
>Mature_258_residues
MVFNSTQDRQAKIVELLRDEQFLAIGRLTEHFQISVATARRDLSELHEAGLLRRTHGGAVSVTQVTQDKPNAARAVWNRA
EKAAIAGVVAGMIVEGDTVLLDAGTTALEVAKKLADRRNLTFISNGLDIVEELTRGEGKSIYSVGGEYTETNRSFRGPLA
EQFIRQFNVDKLILNAASIDVDRGLICTSSPVNASVARAMIEVSSRVIVVADHSKFTKSSLSVTARIEDVGVIVTDSGTR
TIIETIPEKLRKKFVVAN

Specific function: Represses opine catabolism and conjugal transfer of the nopaline Ti plasmid pTiC58

COG id: COG1349

COG function: function code KG; Transcriptional regulators of sugar metabolism

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 HTH deoR-type DNA-binding domain

Homologues:

Organism=Escherichia coli, GI1789059, Length=231, Percent_Identity=33.7662337662338, Blast_Score=125, Evalue=2e-30,
Organism=Escherichia coli, GI1789519, Length=235, Percent_Identity=31.063829787234, Blast_Score=122, Evalue=3e-29,
Organism=Escherichia coli, GI1789829, Length=229, Percent_Identity=34.4978165938865, Blast_Score=115, Evalue=3e-27,
Organism=Escherichia coli, GI1788069, Length=233, Percent_Identity=29.1845493562232, Blast_Score=110, Evalue=8e-26,
Organism=Escherichia coli, GI226510968, Length=248, Percent_Identity=27.8225806451613, Blast_Score=101, Evalue=5e-23,
Organism=Escherichia coli, GI87082344, Length=247, Percent_Identity=29.1497975708502, Blast_Score=99, Evalue=3e-22,
Organism=Escherichia coli, GI1789170, Length=230, Percent_Identity=29.1304347826087, Blast_Score=93, Evalue=2e-20,
Organism=Escherichia coli, GI1790753, Length=249, Percent_Identity=28.5140562248996, Blast_Score=85, Evalue=5e-18,
Organism=Escherichia coli, GI1790635, Length=232, Percent_Identity=23.7068965517241, Blast_Score=74, Evalue=1e-14,
Organism=Escherichia coli, GI1787540, Length=234, Percent_Identity=25.6410256410256, Blast_Score=72, Evalue=3e-14,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): ACCR_AGRT5 (P32104)

Other databases:

- EMBL:   AF010180
- EMBL:   AE007871
- PIR:   AH3244
- PIR:   T03429
- RefSeq:   NP_396661.3
- ProteinModelPortal:   P32104
- STRING:   P32104
- GeneID:   1137461
- GenomeReviews:   AE007871_GR
- KEGG:   atu:Atu6138
- eggNOG:   COG1349
- HOGENOM:   HBG694151
- OMA:   KETERRP
- PhylomeDB:   P32104
- ProtClustDB:   CLSK539906
- BioCyc:   ATUM176299-1:ATU6138-MONOMER
- GO:   GO:0005622
- InterPro:   IPR014036
- InterPro:   IPR001034
- InterPro:   IPR018356
- InterPro:   IPR011991
- Gene3D:   G3DSA:1.10.10.10
- PRINTS:   PR00037
- SMART:   SM00420

Pfam domain/function: PF00455 DeoR; PF08220 HTH_DeoR

EC number: NA

Molecular weight: Translated: 28076; Mature: 28076

Theoretical pI: Translated: 8.49; Mature: 8.49

Prosite motif: PS00894 HTH_DEOR_1; PS51000 HTH_DEOR_2

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.4 %Cys     (Translated Protein)
1.2 %Met     (Translated Protein)
1.6 %Cys+Met (Translated Protein)
0.4 %Cys     (Mature Protein)
1.2 %Met     (Mature Protein)
1.6 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MVFNSTQDRQAKIVELLRDEQFLAIGRLTEHFQISVATARRDLSELHEAGLLRRTHGGAV
CCCCCCCHHHHHHHHHHHCCCCEEHHHCCHHHEEEHHHHHHHHHHHHHHCCCEECCCCEE
SVTQVTQDKPNAARAVWNRAEKAAIAGVVAGMIVEGDTVLLDAGTTALEVAKKLADRRNL
EEEEECCCCCHHHHHHHHHHHHHHHHHHHHHHEECCCEEEEECCCHHHHHHHHHHHCCCC
TFISNGLDIVEELTRGEGKSIYSVGGEYTETNRSFRGPLAEQFIRQFNVDKLILNAASID
EEEECCHHHHHHHHCCCCCEEEECCCCCCCCCCCCCCHHHHHHHHHHCHHHEEEEHHHCC
VDRGLICTSSPVNASVARAMIEVSSRVIVVADHSKFTKSSLSVTARIEDVGVIVTDSGTR
CCCCEEECCCCCCHHHHHHHHHHCCCEEEEECCCCCCCCCCEEEEEEEEEEEEEECCCCH
TIIETIPEKLRKKFVVAN
HHHHHHHHHHHHHCCCCC
>Mature Secondary Structure
MVFNSTQDRQAKIVELLRDEQFLAIGRLTEHFQISVATARRDLSELHEAGLLRRTHGGAV
CCCCCCCHHHHHHHHHHHCCCCEEHHHCCHHHEEEHHHHHHHHHHHHHHCCCEECCCCEE
SVTQVTQDKPNAARAVWNRAEKAAIAGVVAGMIVEGDTVLLDAGTTALEVAKKLADRRNL
EEEEECCCCCHHHHHHHHHHHHHHHHHHHHHHEECCCEEEEECCCHHHHHHHHHHHCCCC
TFISNGLDIVEELTRGEGKSIYSVGGEYTETNRSFRGPLAEQFIRQFNVDKLILNAASID
EEEECCHHHHHHHHCCCCCEEEECCCCCCCCCCCCCCHHHHHHHHHHCHHHEEEEHHHCC
VDRGLICTSSPVNASVARAMIEVSSRVIVVADHSKFTKSSLSVTARIEDVGVIVTDSGTR
CCCCEEECCCCCCHHHHHHHHHHCCCEEEEECCCCCCCCCCEEEEEEEEEEEEEECCCCH
TIIETIPEKLRKKFVVAN
HHHHHHHHHHHHHCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: DNA [C]

Specific reaction: Protein + DNA = Protein-DNA [C]

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: 1731335; 9393724; 11743193; 11743194