Definition Vibrio cholerae O395 chromosome 2, complete sequence.
Accession NC_009457
Length 3,024,069

Click here to switch to the map view.

The map label for this gene is gcvA [H]

Identifier: 147675583

GI number: 147675583

Start: 445755

End: 446675

Strand: Direct

Name: gcvA [H]

Synonym: VC0395_A0418

Alternate gene names: 147675583

Gene position: 445755-446675 (Clockwise)

Preceding gene: 147673207

Following gene: 147674965

Centisome position: 14.74

GC content: 46.47

Gene sequence:

>921_bases
ATGTCCAGAAGATTGCCTCCCCTTAATTCGTTAAAAGTGTTTGAAGCGGCCGCTCGCCATTTGAGTTTTACCCGAGCTGC
TGAAGAATTATTTGTGACACAGGCCGCAGTTAGTCACCAAATCAAAGCATTAGAAGAGTTTTTAGGCTTGAAACTCTTTC
GTCGTCGTAATCGCTCTTTATTGCTGACCGAAGAAGGGCAAAGTTATTTCCTCGACATAAAAGATATTTTTAGTTCATTA
GCTGAAGCGACCGATAAATTACTTGAGCGCAGTGAAAAAGGGGCGCTGACCATTAGTTTGCCGCCGAGTTTTGCGATTCA
ATGGTTAGTGCCACGTTTGGCGGATTTTAACCAGCAAGAGCCGGATATTGACGTGCGCATTAAGGCCGTCGATATGGATG
AAGGTTCGCTGACTGATGATGTGGATGTGGCGATTTATTATGGCCGAGGTAGTTGGCCGGGCTTGCGTGCCGATAAATTG
TATCAGGAGTTTTTGATCCCACTCTGTTCTCCGGCGTTGTTGCTGGGTAACAAGCCAATGGAGAAGTTAAGCGATTTGGC
TTATCACACCTTGTTGCACGATACCTCGCGTAAAGACTGGAAACAATTTGCTAAAGAGAACGGCCTTGATAACGTTAATG
TTAACCATGGGCCGATCTTCAGTCACTCAACCATGGTGTTGCAAGCGGCTGCGCATGGGCAAGGTGTTGCGTTAGGCAAT
AACGTGTTAGCGCAACCAGAAATTGATGCTGGTCGCTTGATTGCTCCTTTTGATGAGGTATTGATGACCAATAACGCCTT
CTATGTGGTGTGCCATGAAAAGCAGGCGGATATGGGACGGATCGCCACTTTCCGCGATTGGATGCTGAAAAAGGCGCGCA
GTGAGCAAGTGGATATTTTGCAACATAAGCACAACCAGTAA

Upstream 100 bases:

>100_bases
CGCCGTTGCGCGGTGAAATATAGATTTTCTCTGGTCGGTTAGCAACGGACAATTTATAATGTTTCAGATTAAAAAAACTA
ATCTTTAACCGAGTACCGCT

Downstream 100 bases:

>100_bases
ATTCGGGTTATGAGGTAGAGGATGAACAGTAAGTATTTACTCGCTCTCGGGGGCTTGCTATCGGGTGTTGCGGTGGGTTT
AGGTGCCTTTGCGGCGCACG

Product: DNA-binding transcriptional activator GcvA

Products: NA

Alternate protein names: Gcv operon activator [H]

Number of amino acids: Translated: 306; Mature: 305

Protein sequence:

>306_residues
MSRRLPPLNSLKVFEAAARHLSFTRAAEELFVTQAAVSHQIKALEEFLGLKLFRRRNRSLLLTEEGQSYFLDIKDIFSSL
AEATDKLLERSEKGALTISLPPSFAIQWLVPRLADFNQQEPDIDVRIKAVDMDEGSLTDDVDVAIYYGRGSWPGLRADKL
YQEFLIPLCSPALLLGNKPMEKLSDLAYHTLLHDTSRKDWKQFAKENGLDNVNVNHGPIFSHSTMVLQAAAHGQGVALGN
NVLAQPEIDAGRLIAPFDEVLMTNNAFYVVCHEKQADMGRIATFRDWMLKKARSEQVDILQHKHNQ

Sequences:

>Translated_306_residues
MSRRLPPLNSLKVFEAAARHLSFTRAAEELFVTQAAVSHQIKALEEFLGLKLFRRRNRSLLLTEEGQSYFLDIKDIFSSL
AEATDKLLERSEKGALTISLPPSFAIQWLVPRLADFNQQEPDIDVRIKAVDMDEGSLTDDVDVAIYYGRGSWPGLRADKL
YQEFLIPLCSPALLLGNKPMEKLSDLAYHTLLHDTSRKDWKQFAKENGLDNVNVNHGPIFSHSTMVLQAAAHGQGVALGN
NVLAQPEIDAGRLIAPFDEVLMTNNAFYVVCHEKQADMGRIATFRDWMLKKARSEQVDILQHKHNQ
>Mature_305_residues
SRRLPPLNSLKVFEAAARHLSFTRAAEELFVTQAAVSHQIKALEEFLGLKLFRRRNRSLLLTEEGQSYFLDIKDIFSSLA
EATDKLLERSEKGALTISLPPSFAIQWLVPRLADFNQQEPDIDVRIKAVDMDEGSLTDDVDVAIYYGRGSWPGLRADKLY
QEFLIPLCSPALLLGNKPMEKLSDLAYHTLLHDTSRKDWKQFAKENGLDNVNVNHGPIFSHSTMVLQAAAHGQGVALGNN
VLAQPEIDAGRLIAPFDEVLMTNNAFYVVCHEKQADMGRIATFRDWMLKKARSEQVDILQHKHNQ

Specific function: Regulatory protein for the glycine cleavage system operon (gcv). Mediates activation of gcv by glycine and repression by purines. GcvA is negatively autoregulated. Bind to three sites upstream of the gcv promoter [H]

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasmic [H]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 HTH lysR-type DNA-binding domain [H]

Homologues:

Organism=Escherichia coli, GI1789173, Length=296, Percent_Identity=71.6216216216216, Blast_Score=456, Evalue=1e-130,
Organism=Escherichia coli, GI1786448, Length=290, Percent_Identity=34.8275862068965, Blast_Score=144, Evalue=7e-36,
Organism=Escherichia coli, GI1788706, Length=294, Percent_Identity=30.2721088435374, Blast_Score=142, Evalue=4e-35,
Organism=Escherichia coli, GI1786401, Length=284, Percent_Identity=28.5211267605634, Blast_Score=101, Evalue=6e-23,
Organism=Escherichia coli, GI145693193, Length=296, Percent_Identity=27.027027027027, Blast_Score=92, Evalue=5e-20,
Organism=Escherichia coli, GI87081978, Length=272, Percent_Identity=29.4117647058824, Blast_Score=82, Evalue=3e-17,
Organism=Escherichia coli, GI157672245, Length=160, Percent_Identity=31.875, Blast_Score=78, Evalue=8e-16,
Organism=Escherichia coli, GI1787879, Length=186, Percent_Identity=29.5698924731183, Blast_Score=68, Evalue=6e-13,
Organism=Escherichia coli, GI1787128, Length=136, Percent_Identity=32.3529411764706, Blast_Score=65, Evalue=6e-12,
Organism=Escherichia coli, GI1790208, Length=246, Percent_Identity=27.6422764227642, Blast_Score=63, Evalue=2e-11,
Organism=Escherichia coli, GI1787589, Length=136, Percent_Identity=34.5588235294118, Blast_Score=62, Evalue=5e-11,
Organism=Escherichia coli, GI145693105, Length=122, Percent_Identity=30.327868852459, Blast_Score=62, Evalue=6e-11,
Organism=Escherichia coli, GI1790262, Length=207, Percent_Identity=26.5700483091787, Blast_Score=62, Evalue=7e-11,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR000847
- InterPro:   IPR005119
- InterPro:   IPR011991 [H]

Pfam domain/function: PF00126 HTH_1; PF03466 LysR_substrate [H]

EC number: NA

Molecular weight: Translated: 34525; Mature: 34394

Theoretical pI: Translated: 6.52; Mature: 6.52

Prosite motif: PS50931 HTH_LYSR

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.7 %Cys     (Translated Protein)
2.3 %Met     (Translated Protein)
2.9 %Cys+Met (Translated Protein)
0.7 %Cys     (Mature Protein)
2.0 %Met     (Mature Protein)
2.6 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSRRLPPLNSLKVFEAAARHLSFTRAAEELFVTQAAVSHQIKALEEFLGLKLFRRRNRSL
CCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCEE
LLTEEGQSYFLDIKDIFSSLAEATDKLLERSEKGALTISLPPSFAIQWLVPRLADFNQQE
EEEECCCEEEEEHHHHHHHHHHHHHHHHHCCCCCEEEEECCHHHHHHHHHHHHHCCCCCC
PDIDVRIKAVDMDEGSLTDDVDVAIYYGRGSWPGLRADKLYQEFLIPLCSPALLLGNKPM
CCCEEEEEEEECCCCCCCCCCEEEEEECCCCCCCCCHHHHHHHHHHHHCCCHHHHCCCCH
EKLSDLAYHTLLHDTSRKDWKQFAKENGLDNVNVNHGPIFSHSTMVLQAAAHGQGVALGN
HHHHHHHHHHHHHCCCHHHHHHHHHHCCCCCCCCCCCCCCCCCHHEEEECCCCCCEEECC
NVLAQPEIDAGRLIAPFDEVLMTNNAFYVVCHEKQADMGRIATFRDWMLKKARSEQVDIL
CEECCCCCCCCCEECCHHHHHCCCCCEEEEEECCCCCCHHHHHHHHHHHHHHCCHHHHHH
QHKHNQ
HHCCCC
>Mature Secondary Structure 
SRRLPPLNSLKVFEAAARHLSFTRAAEELFVTQAAVSHQIKALEEFLGLKLFRRRNRSL
CCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCEE
LLTEEGQSYFLDIKDIFSSLAEATDKLLERSEKGALTISLPPSFAIQWLVPRLADFNQQE
EEEECCCEEEEEHHHHHHHHHHHHHHHHHCCCCCEEEEECCHHHHHHHHHHHHHCCCCCC
PDIDVRIKAVDMDEGSLTDDVDVAIYYGRGSWPGLRADKLYQEFLIPLCSPALLLGNKPM
CCCEEEEEEEECCCCCCCCCCEEEEEECCCCCCCCCHHHHHHHHHHHHCCCHHHHCCCCH
EKLSDLAYHTLLHDTSRKDWKQFAKENGLDNVNVNHGPIFSHSTMVLQAAAHGQGVALGN
HHHHHHHHHHHHHCCCHHHHHHHHHHCCCCCCCCCCCCCCCCCHHEEEECCCCCCEEECC
NVLAQPEIDAGRLIAPFDEVLMTNNAFYVVCHEKQADMGRIATFRDWMLKKARSEQVDIL
CEECCCCCCCCCEECCHHHHHCCCCCEEEEEECCCCCCHHHHHHHHHHHHHHCCHHHHHH
QHKHNQ
HHCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: DNA [C]

Specific reaction: Protein + DNA = Protein-DNA [C]

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: 11206551; 11258796 [H]