Definition Cupriavidus metallidurans CH34 chromosome, complete genome.
Accession NC_007973
Length 3,928,089

Click here to switch to the map view.

The map label for this gene is gcvA [H]

Identifier: 94310712

GI number: 94310712

Start: 1925234

End: 1926178

Strand: Reverse

Name: gcvA [H]

Synonym: Rmet_1774

Alternate gene names: 94310712

Gene position: 1926178-1925234 (Counterclockwise)

Preceding gene: 94310714

Following gene: 94310709

Centisome position: 49.04

GC content: 69.31

Gene sequence:

>945_bases
ATGCAAAAACTGCCGCCCCTGCGCGCATTGCAGGCATTCGAGGCGGTTGCGCGTCACCGCAGTTTCAAGGCCGCAGCGGC
GGAGCTAAACGTGACGCCGACCGCCATCAGCCATCAGATCCGGATGCTCGAGCAGATCTGCGGCAAGGCGTTGCTCCAGC
GACGCCCGCGTCCGCTCCGGCTGACCGTGGCGGGGGAGCGGCTCTATCCGGCGCTGCGTAGTGGTTTCGCGCTGTTTGCC
GAGGCCGTGGCGACCGTTGGGCAGCCCGGTGTGGCACGCCCGCTGCGCGTGACCAGTCCGAACGCTTTCGCGAGCCGCTG
GCTGGTTCCGCGCCTTCCGGCCTGGCAGGGGCTGCATCCCGAATGGCCGCTGGAGATCATCGGCACGGACCGGGTCCTGG
ATCTGGCTGCGGGCGAGGCTGACGTCGCCATTCGCTACGCGCGATGCGCGCCCAAGGGGCTGGTCAGTACAGAGTTCGCG
CGCGATACCTTCTTCGCCGTGGCCAGCCCGATGCTGCTGGCGAGGGCGGGGCGGGAAGGGCAGGCGACATTCGATATCGG
CGATCTCACGCATATCCCCCTGATCCACTACGAATGGAGCAGCGGCGACCCGCACGCCCCGACCTGGGCGCAGTGGTTCG
CGGCTGCGGGTCTCACCGCAGGCGACTCGTCGGCTCGGCGTGGCCGCCATGACCTGAGTTTTCGCGAGGAACTGCACGCC
ATCGACGCGGTGGTGGCCGGCCAGGGCGTGGCGCTATGCAGCAACGTGGTGGTGGACGGCCTGCTGCGCAGTGGCGCGTT
GTGCAAGGCGCACGCGCTGGGGTTGCCCGGCTTCGGCTTCTACGTGGCCCATGCCGCCGGCCATCCGGATCTGGCAGCGG
TGGAGGGCTTTTCAGGCTGGCTGCTGTCGACGGCCGGGACGCCGGCGGGCGAACATCCGGCCTAG

Upstream 100 bases:

>100_bases
GTTGGTCACGCCCCCGAGACCATGGTGGTGCGCGCGGCGGTCGGGTGCAAAGGCAAAGATCTCAGCTTGTAGATGAGAAA
AGCTCACCTAGACTGGACCC

Downstream 100 bases:

>100_bases
TTGGGCGGCATCTCGGGCGGTATCAGGTCCGGGTTCCAGGCGACCTCCCACATATAGCCGTCGGGGTCCTGGAAGTAGCC
GGCATAGCCACCCCAGAAGG

Product: LysR family transcriptional regulator

Products: NA

Alternate protein names: Gcv operon activator [H]

Number of amino acids: Translated: 314; Mature: 314

Protein sequence:

>314_residues
MQKLPPLRALQAFEAVARHRSFKAAAAELNVTPTAISHQIRMLEQICGKALLQRRPRPLRLTVAGERLYPALRSGFALFA
EAVATVGQPGVARPLRVTSPNAFASRWLVPRLPAWQGLHPEWPLEIIGTDRVLDLAAGEADVAIRYARCAPKGLVSTEFA
RDTFFAVASPMLLARAGREGQATFDIGDLTHIPLIHYEWSSGDPHAPTWAQWFAAAGLTAGDSSARRGRHDLSFREELHA
IDAVVAGQGVALCSNVVVDGLLRSGALCKAHALGLPGFGFYVAHAAGHPDLAAVEGFSGWLLSTAGTPAGEHPA

Sequences:

>Translated_314_residues
MQKLPPLRALQAFEAVARHRSFKAAAAELNVTPTAISHQIRMLEQICGKALLQRRPRPLRLTVAGERLYPALRSGFALFA
EAVATVGQPGVARPLRVTSPNAFASRWLVPRLPAWQGLHPEWPLEIIGTDRVLDLAAGEADVAIRYARCAPKGLVSTEFA
RDTFFAVASPMLLARAGREGQATFDIGDLTHIPLIHYEWSSGDPHAPTWAQWFAAAGLTAGDSSARRGRHDLSFREELHA
IDAVVAGQGVALCSNVVVDGLLRSGALCKAHALGLPGFGFYVAHAAGHPDLAAVEGFSGWLLSTAGTPAGEHPA
>Mature_314_residues
MQKLPPLRALQAFEAVARHRSFKAAAAELNVTPTAISHQIRMLEQICGKALLQRRPRPLRLTVAGERLYPALRSGFALFA
EAVATVGQPGVARPLRVTSPNAFASRWLVPRLPAWQGLHPEWPLEIIGTDRVLDLAAGEADVAIRYARCAPKGLVSTEFA
RDTFFAVASPMLLARAGREGQATFDIGDLTHIPLIHYEWSSGDPHAPTWAQWFAAAGLTAGDSSARRGRHDLSFREELHA
IDAVVAGQGVALCSNVVVDGLLRSGALCKAHALGLPGFGFYVAHAAGHPDLAAVEGFSGWLLSTAGTPAGEHPA

Specific function: Regulatory protein for the glycine cleavage system operon (gcv). Mediates activation of gcv by glycine and repression by purines. GcvA is negatively autoregulated. Bind to three sites upstream of the gcv promoter [H]

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasmic [H]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 HTH lysR-type DNA-binding domain [H]

Homologues:

Organism=Escherichia coli, GI1789173, Length=306, Percent_Identity=32.0261437908497, Blast_Score=130, Evalue=1e-31,
Organism=Escherichia coli, GI1786448, Length=306, Percent_Identity=29.4117647058824, Blast_Score=106, Evalue=2e-24,
Organism=Escherichia coli, GI1788706, Length=318, Percent_Identity=28.6163522012579, Blast_Score=94, Evalue=2e-20,
Organism=Escherichia coli, GI145693193, Length=280, Percent_Identity=27.1428571428571, Blast_Score=83, Evalue=3e-17,
Organism=Escherichia coli, GI87081978, Length=198, Percent_Identity=29.7979797979798, Blast_Score=70, Evalue=1e-13,
Organism=Escherichia coli, GI1787128, Length=282, Percent_Identity=25.531914893617, Blast_Score=70, Evalue=2e-13,
Organism=Escherichia coli, GI1786401, Length=269, Percent_Identity=25.6505576208178, Blast_Score=65, Evalue=8e-12,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR000847
- InterPro:   IPR005119
- InterPro:   IPR011991 [H]

Pfam domain/function: PF00126 HTH_1; PF03466 LysR_substrate [H]

EC number: NA

Molecular weight: Translated: 33543; Mature: 33543

Theoretical pI: Translated: 8.66; Mature: 8.66

Prosite motif: PS50931 HTH_LYSR

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.3 %Cys     (Translated Protein)
1.0 %Met     (Translated Protein)
2.2 %Cys+Met (Translated Protein)
1.3 %Cys     (Mature Protein)
1.0 %Met     (Mature Protein)
2.2 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MQKLPPLRALQAFEAVARHRSFKAAAAELNVTPTAISHQIRMLEQICGKALLQRRPRPLR
CCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCEE
LTVAGERLYPALRSGFALFAEAVATVGQPGVARPLRVTSPNAFASRWLVPRLPAWQGLHP
EEEECHHHHHHHHHHHHHHHHHHHHCCCCCCCCCEEECCCCHHHHCCCCCCCCCCCCCCC
EWPLEIIGTDRVLDLAAGEADVAIRYARCAPKGLVSTEFARDTFFAVASPMLLARAGREG
CCCEEEECCCCEEEECCCCCHHEEEEECCCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCC
QATFDIGDLTHIPLIHYEWSSGDPHAPTWAQWFAAAGLTAGDSSARRGRHDLSFREELHA
CEEEECCCCCCCCEEEEECCCCCCCCCHHHHHHHHCCCCCCCCHHHCCCCCCHHHHHHHH
IDAVVAGQGVALCSNVVVDGLLRSGALCKAHALGLPGFGFYVAHAAGHPDLAAVEGFSGW
HHHHHHCCCHHHHHHHHHHHHHHCCCHHHHHHCCCCCHHHHEEECCCCCCHHEECCCCCE
LLSTAGTPAGEHPA
EEECCCCCCCCCCC
>Mature Secondary Structure
MQKLPPLRALQAFEAVARHRSFKAAAAELNVTPTAISHQIRMLEQICGKALLQRRPRPLR
CCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCEE
LTVAGERLYPALRSGFALFAEAVATVGQPGVARPLRVTSPNAFASRWLVPRLPAWQGLHP
EEEECHHHHHHHHHHHHHHHHHHHHCCCCCCCCCEEECCCCHHHHCCCCCCCCCCCCCCC
EWPLEIIGTDRVLDLAAGEADVAIRYARCAPKGLVSTEFARDTFFAVASPMLLARAGREG
CCCEEEECCCCEEEECCCCCHHEEEEECCCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCC
QATFDIGDLTHIPLIHYEWSSGDPHAPTWAQWFAAAGLTAGDSSARRGRHDLSFREELHA
CEEEECCCCCCCCEEEEECCCCCCCCCHHHHHHHHCCCCCCCCHHHCCCCCCHHHHHHHH
IDAVVAGQGVALCSNVVVDGLLRSGALCKAHALGLPGFGFYVAHAAGHPDLAAVEGFSGW
HHHHHHCCCHHHHHHHHHHHHHHCCCHHHHHHCCCCCHHHHEEECCCCCCHHEECCCCCE
LLSTAGTPAGEHPA
EEECCCCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: DNA [C]

Specific reaction: Protein + DNA = Protein-DNA [C]

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: 11206551; 11258796 [H]