Definition Azoarcus sp. BH72 chromosome, complete genome.
Accession NC_008702
Length 4,376,040

Click here to switch to the map view.

The map label for this gene is gcvA [C]

Identifier: 119897306

GI number: 119897306

Start: 1091631

End: 1092566

Strand: Direct

Name: gcvA [C]

Synonym: azo1015

Alternate gene names: 119897306

Gene position: 1091631-1092566 (Clockwise)

Preceding gene: 119897305

Following gene: 119897307

Centisome position: 24.95

GC content: 70.41

Gene sequence:

>936_bases
ATGCCTGTCCGCCCCGATGTACGTTTTCCGTCGATCGAAGGTCTGCGTGCATTCGAGGCCGCGGCGCGGCTTGGCACCTT
CGAGCGCGCTGCGGACGAACTGAGCGTCACGGCGAGCGCCGTCAGCAAGCGCGTTGCCGCGGTGGAGGAATTGGTCGGCG
CGCTGCTTTTCAGCCGCAGCGGAAAGACGCTGGTACCGACCCCTGCCGGGCGGGAATACCTCGAGCAGGTGCGCGCCGCG
CTTGGTCTGCTGGCGGCGATGCCGCTGCACCGCCGCGCAGTGCAGCGGATGACGCGGCTGAGGGTGTGCGCCCCGCCCAC
CTTCGCGCGCCAGATTCTGGTTCCGGCACTGGACGGTTTCGTTGCCGAGCATCCCGATGTGGAGCTTGAGATCGTTCTTA
GCGTGCCTTACCTGGACGCCGCCTCGGCTGACGTCGATGTGGAGATCCGGCACGGCGGCCCTCAGCATCACGGCGGCGAC
GTACTGATCCGGGACGTTTTGCTGCCGATGGCCGCTCCTGCGCTGCTTGCACAGACCGGCCCGCTGACGCGGCCGGCCGA
TCTGCAGCGCCTGCGCCTGCTGCGCACCCCGCTCGAGCCGTGGACACAGTGGTTCGCGGCGGCGGGCCTCGACTGGCCGG
AACCGGCGCGTGGTGCGCGGCTGGTTGACCTTGGGCTGCTGCTTGAAGCCGCGGTGTGCGGGCAGGGGGTCGCGCTCGGA
CGTCCGAGTCTTGCACGGCAGTGGCTGCGCAGCGGCGCGCTGGTGGCGCTGTTCGACGTGGCGCCGCCCAGCCGGACGCA
CTACTTCCTTGCCCCGCAGCCGGCCTCGCTCAGCGAGACGGCGCGGGACGTGCGCGCCGCGTTCGAAAACTGGCTGCGGG
CCGTGTGCGCCGGGGTGGAGCGGGAAGCGGCTGAACTTGTTTCTGGCGCGCCCTGA

Upstream 100 bases:

>100_bases
TTCCCGCTAAACGAGGGGTCAAGAATACGTTCTTGACCCCTTTGTTTTTTTCCTGCGCCCGGATAGCCTTCGACGCATTC
ATCAACGCCCGTCGCTGCCG

Downstream 100 bases:

>100_bases
ACAATATTCCGACATCGGCGCGGCGCCGGTGGCGATGATGGCGGCCATTGCCAACGCCAACTCCGAGGACGTCCATCCAT
GCCCGCTGCACCCATCACCT

Product: LysR family transcriptional regulator

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 311; Mature: 310

Protein sequence:

>311_residues
MPVRPDVRFPSIEGLRAFEAAARLGTFERAADELSVTASAVSKRVAAVEELVGALLFSRSGKTLVPTPAGREYLEQVRAA
LGLLAAMPLHRRAVQRMTRLRVCAPPTFARQILVPALDGFVAEHPDVELEIVLSVPYLDAASADVDVEIRHGGPQHHGGD
VLIRDVLLPMAAPALLAQTGPLTRPADLQRLRLLRTPLEPWTQWFAAAGLDWPEPARGARLVDLGLLLEAAVCGQGVALG
RPSLARQWLRSGALVALFDVAPPSRTHYFLAPQPASLSETARDVRAAFENWLRAVCAGVEREAAELVSGAP

Sequences:

>Translated_311_residues
MPVRPDVRFPSIEGLRAFEAAARLGTFERAADELSVTASAVSKRVAAVEELVGALLFSRSGKTLVPTPAGREYLEQVRAA
LGLLAAMPLHRRAVQRMTRLRVCAPPTFARQILVPALDGFVAEHPDVELEIVLSVPYLDAASADVDVEIRHGGPQHHGGD
VLIRDVLLPMAAPALLAQTGPLTRPADLQRLRLLRTPLEPWTQWFAAAGLDWPEPARGARLVDLGLLLEAAVCGQGVALG
RPSLARQWLRSGALVALFDVAPPSRTHYFLAPQPASLSETARDVRAAFENWLRAVCAGVEREAAELVSGAP
>Mature_310_residues
PVRPDVRFPSIEGLRAFEAAARLGTFERAADELSVTASAVSKRVAAVEELVGALLFSRSGKTLVPTPAGREYLEQVRAAL
GLLAAMPLHRRAVQRMTRLRVCAPPTFARQILVPALDGFVAEHPDVELEIVLSVPYLDAASADVDVEIRHGGPQHHGGDV
LIRDVLLPMAAPALLAQTGPLTRPADLQRLRLLRTPLEPWTQWFAAAGLDWPEPARGARLVDLGLLLEAAVCGQGVALGR
PSLARQWLRSGALVALFDVAPPSRTHYFLAPQPASLSETARDVRAAFENWLRAVCAGVEREAAELVSGAP

Specific function: Regulatory Protein For The Glycine Cleavage System Operon (Gcv). Mediates Activation Of Gcv By Glycine And Repression By Purines. Gcva Is Negatively Autoregulated. Bind To Three Sites Upstream Of The Gcv Promoter. [C]

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 HTH lysR-type DNA-binding domain [H]

Homologues:

Organism=Escherichia coli, GI1789173, Length=298, Percent_Identity=31.2080536912752, Blast_Score=124, Evalue=6e-30,
Organism=Escherichia coli, GI1786448, Length=285, Percent_Identity=32.280701754386, Blast_Score=103, Evalue=1e-23,
Organism=Escherichia coli, GI1788706, Length=280, Percent_Identity=28.5714285714286, Blast_Score=91, Evalue=8e-20,
Organism=Escherichia coli, GI145693193, Length=317, Percent_Identity=27.4447949526814, Blast_Score=77, Evalue=2e-15,
Organism=Escherichia coli, GI1787128, Length=282, Percent_Identity=24.468085106383, Blast_Score=66, Evalue=2e-12,
Organism=Escherichia coli, GI1787589, Length=274, Percent_Identity=24.0875912408759, Blast_Score=64, Evalue=2e-11,
Organism=Escherichia coli, GI157672245, Length=119, Percent_Identity=34.453781512605, Blast_Score=62, Evalue=6e-11,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR000847
- InterPro:   IPR005119
- InterPro:   IPR011991 [H]

Pfam domain/function: PF00126 HTH_1; PF03466 LysR_substrate [H]

EC number: NA

Molecular weight: Translated: 33455; Mature: 33324

Theoretical pI: Translated: 7.13; Mature: 7.13

Prosite motif: PS50931 HTH_LYSR

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.0 %Cys     (Translated Protein)
1.3 %Met     (Translated Protein)
2.3 %Cys+Met (Translated Protein)
1.0 %Cys     (Mature Protein)
1.0 %Met     (Mature Protein)
1.9 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MPVRPDVRFPSIEGLRAFEAAARLGTFERAADELSVTASAVSKRVAAVEELVGALLFSRS
CCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCC
GKTLVPTPAGREYLEQVRAALGLLAAMPLHRRAVQRMTRLRVCAPPTFARQILVPALDGF
CCEECCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHH
VAEHPDVELEIVLSVPYLDAASADVDVEIRHGGPQHHGGDVLIRDVLLPMAAPALLAQTG
HHCCCCCEEEEEEECCCCCCCCCCEEEEEECCCCCCCCCHHHHHHHHHHHHHHHHHHCCC
PLTRPADLQRLRLLRTPLEPWTQWFAAAGLDWPEPARGARLVDLGLLLEAAVCGQGVALG
CCCCCHHHHHHHHHHCCHHHHHHHHHHCCCCCCCCCCCCCHHHHHHHHHHHHHCCCCCCC
RPSLARQWLRSGALVALFDVAPPSRTHYFLAPQPASLSETARDVRAAFENWLRAVCAGVE
CHHHHHHHHHCCCEEEEEECCCCCCCEEEECCCCCCHHHHHHHHHHHHHHHHHHHHHCHH
REAAELVSGAP
HHHHHHHCCCC
>Mature Secondary Structure 
PVRPDVRFPSIEGLRAFEAAARLGTFERAADELSVTASAVSKRVAAVEELVGALLFSRS
CCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCC
GKTLVPTPAGREYLEQVRAALGLLAAMPLHRRAVQRMTRLRVCAPPTFARQILVPALDGF
CCEECCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHH
VAEHPDVELEIVLSVPYLDAASADVDVEIRHGGPQHHGGDVLIRDVLLPMAAPALLAQTG
HHCCCCCEEEEEEECCCCCCCCCCEEEEEECCCCCCCCCHHHHHHHHHHHHHHHHHHCCC
PLTRPADLQRLRLLRTPLEPWTQWFAAAGLDWPEPARGARLVDLGLLLEAAVCGQGVALG
CCCCCHHHHHHHHHHCCHHHHHHHHHHCCCCCCCCCCCCCHHHHHHHHHHHHHCCCCCCC
RPSLARQWLRSGALVALFDVAPPSRTHYFLAPQPASLSETARDVRAAFENWLRAVCAGVE
CHHHHHHHHHCCCEEEEEECCCCCCCEEEECCCCCCHHHHHHHHHHHHHHHHHHHHHCHH
REAAELVSGAP
HHHHHHHCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: DNA [C]

Specific reaction: Protein + DNA = Protein-DNA [C]

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: 9163424 [H]