Definition Azorhizobium caulinodans ORS 571, complete genome.
Accession NC_009937
Length 5,369,772

Click here to switch to the map view.

The map label for this gene is araC [C]

Identifier: 158422938

GI number: 158422938

Start: 1472106

End: 1473059

Strand: Reverse

Name: araC [C]

Synonym: AZC_1314

Alternate gene names: 158422938

Gene position: 1473059-1472106 (Counterclockwise)

Preceding gene: 158422939

Following gene: 158422935

Centisome position: 27.43

GC content: 60.06

Gene sequence:

>954_bases
ATGGAACTGGCCAACTATGGGAAGCGGCTCGATGACCACTGGAGGGGGATCTGCTCAGCCTCCCAGATCTCGGCTCCTGG
CCATTCCGACGTCGGCCTGTCGGTTGCGCGGATAACAGGAGGACCGAATTTCGGCTTCGTGGATCCGGTGCCGGCACAGG
ACGGCTATGCGCTTTCGCTCGAGCTGATCGATTATCAGCGTGGCGACCTCTGGCTCGATGGTCGCAACACGCCGCAGATC
GATCTCAAGCGCAATAACAGCGTGCTTTTCGACCTGCGCCACAAGGTCGAAGCTCGACTGGAGGACCCGTTCGACACCAT
CCATTTTCACATCCCCCACCGCTATTTCGATGCGCTCTGTGTGGCGTCAGGCCGTCCGGCTATTAGCGATCTCAATTTCG
TCAGTGGCCACGGCTTCTTCGACCAGACGCTGATGCATCTGGGAATGGCGATGATTCCTGCATTGGAGCGCCCCGCGGAA
TCCAGTCATCTGTTTCTCGATCAAATGATGGTTGCGCTCTGCACATATCTCGCGAACACCTATGGCGTTGCTCTGGAGAC
AAGACCCGGCCCGCAAGGCCTGGTGCCATGGCGCCTGAAACGCGCCAAGGACCTGATCGCGAGCCGCCTGAGCGGGAACC
TGACCATCGCGGAGATCGCGGCCGACTGCGGCCTGACACCGAGCTATTTCACTCGGCAATTCGCAGCATCCACCGGCATG
ACACCTCATCGCTGGCTTCTCAAGATGCGCGTGGAGGCGGCGAAGCAGCTGATTTCTGAGGGCAGGCTTTCACTCGTGGA
AGTCGCGCTCTCCTGTGGCTTCGCGGACCAGAGTCACCTCACCCGTATTTTCTCAAGGGAGGTGGGCACGCCTCCACGGA
CGTGGGCGAGAAACATGCTTCCAAGGCACCTCGCAACGCCAGCCGGCGTGAGATCCGGCGAAGGCAATTTCTGA

Upstream 100 bases:

>100_bases
CTTTTGGACATAAAGGCGCTCGTGTAAAGTTGGGCAGTACAGGACATCAAATGATACCGTCGAATTTGAGCCATGTACGT
TTTGAACACCAAGGATCGAA

Downstream 100 bases:

>100_bases
TTGCTCATTAACGCCGGCCTGCGGAAACTGAGGCGGATCAGGGCCCACCCGATCCGCCGCCAAGGCGAGGCCGAAAGCGA
CACTCCCGGCTTTCAACGCA

Product: transcriptional regulator

Products: NA

Alternate protein names: Transcriptional Regulator AraC Family; Transcriptional Regulator; Helix-Turn-Helix Domain-Containing Protein; Transcriptional Regulator AraC Family Protein; Transcriptional Regulator Protein; AraC/XylS Family Transcriptional Regulator; Helix-Turn-Helix- Domain Containing Protein AraC Type; AraC Family Regulatory Protein; AraC-Family Transcriptional Regulator; AraC/XylS Family Transcription Factor; AraC Family Transcription Regulator Protein; Two Component System Response Regulator; Transcriptional Regulator AraC-Type; Regulator; Transcriptional Activator; Transcriptional Regulatory Protein; Proline Utilization Regulator; AraC Family Transcription Regulator; Transcription Regulator Protein; AraC Type Helix-Turn-Helix- Domain-Containing Protein; Helix-Turn-Helix AraC Type; Transcriptional Regulator Protein AraC Family; Regulatory Protein PocR; AraC Family Helix-Turn-Helix Transcriptional Regulator; Transcription Regulator; Xyls/AraC-Type Transcriptional Activator

Number of amino acids: Translated: 317; Mature: 317

Protein sequence:

>317_residues
MELANYGKRLDDHWRGICSASQISAPGHSDVGLSVARITGGPNFGFVDPVPAQDGYALSLELIDYQRGDLWLDGRNTPQI
DLKRNNSVLFDLRHKVEARLEDPFDTIHFHIPHRYFDALCVASGRPAISDLNFVSGHGFFDQTLMHLGMAMIPALERPAE
SSHLFLDQMMVALCTYLANTYGVALETRPGPQGLVPWRLKRAKDLIASRLSGNLTIAEIAADCGLTPSYFTRQFAASTGM
TPHRWLLKMRVEAAKQLISEGRLSLVEVALSCGFADQSHLTRIFSREVGTPPRTWARNMLPRHLATPAGVRSGEGNF

Sequences:

>Translated_317_residues
MELANYGKRLDDHWRGICSASQISAPGHSDVGLSVARITGGPNFGFVDPVPAQDGYALSLELIDYQRGDLWLDGRNTPQI
DLKRNNSVLFDLRHKVEARLEDPFDTIHFHIPHRYFDALCVASGRPAISDLNFVSGHGFFDQTLMHLGMAMIPALERPAE
SSHLFLDQMMVALCTYLANTYGVALETRPGPQGLVPWRLKRAKDLIASRLSGNLTIAEIAADCGLTPSYFTRQFAASTGM
TPHRWLLKMRVEAAKQLISEGRLSLVEVALSCGFADQSHLTRIFSREVGTPPRTWARNMLPRHLATPAGVRSGEGNF
>Mature_317_residues
MELANYGKRLDDHWRGICSASQISAPGHSDVGLSVARITGGPNFGFVDPVPAQDGYALSLELIDYQRGDLWLDGRNTPQI
DLKRNNSVLFDLRHKVEARLEDPFDTIHFHIPHRYFDALCVASGRPAISDLNFVSGHGFFDQTLMHLGMAMIPALERPAE
SSHLFLDQMMVALCTYLANTYGVALETRPGPQGLVPWRLKRAKDLIASRLSGNLTIAEIAADCGLTPSYFTRQFAASTGM
TPHRWLLKMRVEAAKQLISEGRLSLVEVALSCGFADQSHLTRIFSREVGTPPRTWARNMLPRHLATPAGVRSGEGNF

Specific function: Activator Of The L-Rhamnose Operon. Rhar Putatively Autoregulates Its Synthesis. [C]

COG id: COG2207

COG function: function code K; AraC-type DNA-binding domain-containing proteins

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 35083; Mature: 35083

Theoretical pI: Translated: 7.66; Mature: 7.66

Prosite motif: PS00041 HTH_ARAC_FAMILY_1 ; PS01124 HTH_ARAC_FAMILY_2

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.6 %Cys     (Translated Protein)
2.8 %Met     (Translated Protein)
4.4 %Cys+Met (Translated Protein)
1.6 %Cys     (Mature Protein)
2.8 %Met     (Mature Protein)
4.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MELANYGKRLDDHWRGICSASQISAPGHSDVGLSVARITGGPNFGFVDPVPAQDGYALSL
CCHHHHHHHHHHHHHHHCCHHHCCCCCCCCCCEEEEEEECCCCCCCCCCCCCCCCCEEEE
ELIDYQRGDLWLDGRNTPQIDLKRNNSVLFDLRHKVEARLEDPFDTIHFHIPHRYFDALC
EEEECCCCCEEECCCCCCEEEEECCCCEEEEHHHHHHHHHCCCCCEEEEECCHHHHHHHH
VASGRPAISDLNFVSGHGFFDQTLMHLGMAMIPALERPAESSHLFLDQMMVALCTYLANT
HCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHH
YGVALETRPGPQGLVPWRLKRAKDLIASRLSGNLTIAEIAADCGLTPSYFTRQFAASTGM
HCEEEECCCCCCCCCHHHHHHHHHHHHHHHCCCEEHHHHHHHCCCCHHHHHHHHHHHCCC
TPHRWLLKMRVEAAKQLISEGRLSLVEVALSCGFADQSHLTRIFSREVGTPPRTWARNML
CHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHCCCCCHHHHHHHHHHHCCCCHHHHHHHHC
PRHLATPAGVRSGEGNF
HHHHCCCCCCCCCCCCC
>Mature Secondary Structure
MELANYGKRLDDHWRGICSASQISAPGHSDVGLSVARITGGPNFGFVDPVPAQDGYALSL
CCHHHHHHHHHHHHHHHCCHHHCCCCCCCCCCEEEEEEECCCCCCCCCCCCCCCCCEEEE
ELIDYQRGDLWLDGRNTPQIDLKRNNSVLFDLRHKVEARLEDPFDTIHFHIPHRYFDALC
EEEECCCCCEEECCCCCCEEEEECCCCEEEEHHHHHHHHHCCCCCEEEEECCHHHHHHHH
VASGRPAISDLNFVSGHGFFDQTLMHLGMAMIPALERPAESSHLFLDQMMVALCTYLANT
HCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHH
YGVALETRPGPQGLVPWRLKRAKDLIASRLSGNLTIAEIAADCGLTPSYFTRQFAASTGM
HCEEEECCCCCCCCCHHHHHHHHHHHHHHHCCCEEHHHHHHHCCCCHHHHHHHHHHHCCC
TPHRWLLKMRVEAAKQLISEGRLSLVEVALSCGFADQSHLTRIFSREVGTPPRTWARNML
CHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHCCCCCHHHHHHHHHHHCCCCHHHHHHHHC
PRHLATPAGVRSGEGNF
HHHHCCCCCCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: NA