Definition Burkholderia mallei NCTC 10247 chromosome II, complete genome.
Accession NC_009079
Length 2,352,693

Click here to switch to the map view.

The map label for this gene is gcvA [H]

Identifier: 126447955

GI number: 126447955

Start: 1574913

End: 1575821

Strand: Direct

Name: gcvA [H]

Synonym: BMA10247_A1635

Alternate gene names: 126447955

Gene position: 1574913-1575821 (Clockwise)

Preceding gene: 126445696

Following gene: 126445646

Centisome position: 66.94

GC content: 71.51

Gene sequence:

>909_bases
ATGCGCAAAGGCATTCCGAACCTCGCGGCGCTGCAAGTCTTCGAAGCGGCGGCCCGCCACGAAAGCTTTACCCGCGCGGC
CGACGAGCTCGCGCTCACGCAAAGCGCGGTCAGCCGCCAGATCACGTCGCTCGAGGAGCGGCTCGGCGTCGCGTTGTTCC
TGCGGATCAAGAAACGGGTCGTGCTGACGCCGCACGGCCGCCATTATGCGGCGCTCGTGCGGCGCAACCTCGAGCGCATC
GAGCGCGACACGCTCGAGCTGATGGCGCAGCGCGGCATCGGCGCGACGCTCGAGCTCGCGGTCGTGCCGACGTTCGCGAG
CCAGTGGCTGATTCCGCGCCTGCCGCAGTTCCGCGCGCTGCGGCCCGACATCACGGTGAACCTGTCGGTGCGCACCGGGC
CGTTCCTCTTCAGCGATTCGACGTTCGACGCGGCGATCTACTTCGGCCACGCGCTGTGGCCCGGCACGCAGGGGCGGCTG
CTGTTCCTCGAAGGCGACATGCTGCCCGTCTGCAGCCCGGCGCTGCTGGGCGCGAACGGGCGGCGCATCACGCGCGACGC
GCTGCTCGATCTGCCGCTGCTGCACCTGTCGACGCGCGCGGACGCGTGGCGCGACTGGTTTCGCGCGCAAGGCCTCGACA
ACGATCTGCGCGCGGTGCGCGGCCCGCGCTACGAGCTGTTCACGATGCTGACGGCGGCCGCGCACGCGGGCATGGGCGTC
GCGCTGATGCCGGCGCTGCTCGTCGCGGACGAGCTCGCATCGGGCCGCCTTTGCGCGCCGCTCGACCTGCGGCTGCCGAG
CGACGCCGGCTATTACCTCGTCGCGCCGGACGCGGCCGCCGACAGCGAGCCGTTCGTCGCGTTGGCCGAATGGCTGGGTT
CCGTCTCGCCGGCGCGGCCGATAAGCTGA

Upstream 100 bases:

>100_bases
ATGGATTCTCGGTGCGCGAAATTCACCCGGCAATTGATATAAACTCACCAGTTCATTCCAAAAACTCACCAACTGCGATT
CTCCGATCGCTCGAGCATCG

Downstream 100 bases:

>100_bases
CGCGACGCTCCTGTTCATCCGTTCATCGGCCGGCGGCAGGCCGGCCACGCGAGACCGACCATGACCATTCGCATCGACGA
CATCGTGCCGCTGTCCATCG

Product: LysR family transcriptional regulator

Products: NA

Alternate protein names: Gcv operon activator [H]

Number of amino acids: Translated: 302; Mature: 302

Protein sequence:

>302_residues
MRKGIPNLAALQVFEAAARHESFTRAADELALTQSAVSRQITSLEERLGVALFLRIKKRVVLTPHGRHYAALVRRNLERI
ERDTLELMAQRGIGATLELAVVPTFASQWLIPRLPQFRALRPDITVNLSVRTGPFLFSDSTFDAAIYFGHALWPGTQGRL
LFLEGDMLPVCSPALLGANGRRITRDALLDLPLLHLSTRADAWRDWFRAQGLDNDLRAVRGPRYELFTMLTAAAHAGMGV
ALMPALLVADELASGRLCAPLDLRLPSDAGYYLVAPDAAADSEPFVALAEWLGSVSPARPIS

Sequences:

>Translated_302_residues
MRKGIPNLAALQVFEAAARHESFTRAADELALTQSAVSRQITSLEERLGVALFLRIKKRVVLTPHGRHYAALVRRNLERI
ERDTLELMAQRGIGATLELAVVPTFASQWLIPRLPQFRALRPDITVNLSVRTGPFLFSDSTFDAAIYFGHALWPGTQGRL
LFLEGDMLPVCSPALLGANGRRITRDALLDLPLLHLSTRADAWRDWFRAQGLDNDLRAVRGPRYELFTMLTAAAHAGMGV
ALMPALLVADELASGRLCAPLDLRLPSDAGYYLVAPDAAADSEPFVALAEWLGSVSPARPIS
>Mature_302_residues
MRKGIPNLAALQVFEAAARHESFTRAADELALTQSAVSRQITSLEERLGVALFLRIKKRVVLTPHGRHYAALVRRNLERI
ERDTLELMAQRGIGATLELAVVPTFASQWLIPRLPQFRALRPDITVNLSVRTGPFLFSDSTFDAAIYFGHALWPGTQGRL
LFLEGDMLPVCSPALLGANGRRITRDALLDLPLLHLSTRADAWRDWFRAQGLDNDLRAVRGPRYELFTMLTAAAHAGMGV
ALMPALLVADELASGRLCAPLDLRLPSDAGYYLVAPDAAADSEPFVALAEWLGSVSPARPIS

Specific function: Regulatory protein for the glycine cleavage system operon (gcv). Mediates activation of gcv by glycine and repression by purines. GcvA is negatively autoregulated. Bind to three sites upstream of the gcv promoter [H]

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasmic [H]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 HTH lysR-type DNA-binding domain [H]

Homologues:

Organism=Escherichia coli, GI1789173, Length=294, Percent_Identity=38.7755102040816, Blast_Score=177, Evalue=1e-45,
Organism=Escherichia coli, GI1788706, Length=277, Percent_Identity=32.8519855595668, Blast_Score=125, Evalue=2e-30,
Organism=Escherichia coli, GI1786448, Length=291, Percent_Identity=31.9587628865979, Blast_Score=115, Evalue=5e-27,
Organism=Escherichia coli, GI145693193, Length=301, Percent_Identity=30.2325581395349, Blast_Score=90, Evalue=2e-19,
Organism=Escherichia coli, GI1787589, Length=282, Percent_Identity=25.886524822695, Blast_Score=72, Evalue=6e-14,
Organism=Escherichia coli, GI157672245, Length=124, Percent_Identity=41.1290322580645, Blast_Score=67, Evalue=1e-12,
Organism=Escherichia coli, GI1786401, Length=269, Percent_Identity=26.3940520446097, Blast_Score=67, Evalue=2e-12,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR000847
- InterPro:   IPR005119
- InterPro:   IPR011991 [H]

Pfam domain/function: PF00126 HTH_1; PF03466 LysR_substrate [H]

EC number: NA

Molecular weight: Translated: 33140; Mature: 33140

Theoretical pI: Translated: 8.71; Mature: 8.71

Prosite motif: PS50931 HTH_LYSR

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.7 %Cys     (Translated Protein)
2.0 %Met     (Translated Protein)
2.6 %Cys+Met (Translated Protein)
0.7 %Cys     (Mature Protein)
2.0 %Met     (Mature Protein)
2.6 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MRKGIPNLAALQVFEAAARHESFTRAADELALTQSAVSRQITSLEERLGVALFLRIKKRV
CCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHEEEECCEE
VLTPHGRHYAALVRRNLERIERDTLELMAQRGIGATLELAVVPTFASQWLIPRLPQFRAL
EECCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCEEEEEEECCHHHCCCCCCCCCHHCC
RPDITVNLSVRTGPFLFSDSTFDAAIYFGHALWPGTQGRLLFLEGDMLPVCSPALLGANG
CCCEEEEEEEECCCEEEECCCCCCCEEECHHCCCCCCCEEEEEECCCCCCCCHHHCCCCC
RRITRDALLDLPLLHLSTRADAWRDWFRAQGLDNDLRAVRGPRYELFTMLTAAAHAGMGV
CEEHHHHHHHCHHHHHHHHHHHHHHHHHHCCCCHHHHHHCCCCHHHHHHHHHHHHCCCCH
ALMPALLVADELASGRLCAPLDLRLPSDAGYYLVAPDAAADSEPFVALAEWLGSVSPARP
HHHHHHHHHHHHCCCCCCCCEEEECCCCCCEEEECCCCCCCCCCHHHHHHHHCCCCCCCC
IS
CC
>Mature Secondary Structure
MRKGIPNLAALQVFEAAARHESFTRAADELALTQSAVSRQITSLEERLGVALFLRIKKRV
CCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHEEEECCEE
VLTPHGRHYAALVRRNLERIERDTLELMAQRGIGATLELAVVPTFASQWLIPRLPQFRAL
EECCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCEEEEEEECCHHHCCCCCCCCCHHCC
RPDITVNLSVRTGPFLFSDSTFDAAIYFGHALWPGTQGRLLFLEGDMLPVCSPALLGANG
CCCEEEEEEEECCCEEEECCCCCCCEEECHHCCCCCCCEEEEEECCCCCCCCHHHCCCCC
RRITRDALLDLPLLHLSTRADAWRDWFRAQGLDNDLRAVRGPRYELFTMLTAAAHAGMGV
CEEHHHHHHHCHHHHHHHHHHHHHHHHHHCCCCHHHHHHCCCCHHHHHHHHHHHHCCCCH
ALMPALLVADELASGRLCAPLDLRLPSDAGYYLVAPDAAADSEPFVALAEWLGSVSPARP
HHHHHHHHHHHHCCCCCCCCEEEECCCCCCEEEECCCCCCCCCCHHHHHHHHCCCCCCCC
IS
CC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: DNA [C]

Specific reaction: Protein + DNA = Protein-DNA [C]

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: 11206551; 11258796 [H]