Definition Rhizobium etli CFN 42 plasmid p42f, complete sequence.
Accession NC_007766
Length 642,517

Click here to switch to the map view.

The map label for this gene is comC [H]

Identifier: 86361096

GI number: 86361096

Start: 414417

End: 415451

Strand: Reverse

Name: comC [H]

Synonym: RHE_PF00366

Alternate gene names: 86361096

Gene position: 415451-414417 (Counterclockwise)

Preceding gene: 86361099

Following gene: 86361095

Centisome position: 64.66

GC content: 66.76

Gene sequence:

>1035_bases
ATGCGAGTTGCCGAAGCGGAAGCCCTTGCGCTTGCCACCCACGTGCTGGAGGAGCATGGCGCACCGCCTGACCATGCGGC
CCTGCAGGCTCGCGTCTTGGTAACGGCCGAGATGAAGGGGCACCCCTCCCACGGCCTGTACCGGCTTCCGCTCCTGGTCG
AAAGGATCGAGCGCGGTGTTGTCGACCCGCAGTCGAAGGGAACGCAGCGCTGGCGCGCGGATGCGGTGCTGGAGGTCGAG
GGTTCAGCGGGATTTGGCCCCGTCGTCGCCCAGACGGGGATCGAGCGGCTGGCGCCCCATATTCCTGATCTTGGCATCGG
CCTCGTCACCGTGCGCAATGCGAACCATCTCGGCATGCTTGCGCATTATGTGGAGACCATCTCTGCAATGGGATTCGTGG
GCATTGCGCTTTCTTCGAGCGAGGCGCTTGTCCATCCCTACGGCGGTACACGGGCGATGCTCGGCACCAACCCCATCGCC
ATCGGCGTCCCGACCGCCGCGGATCCTCTGGTGCTCGACCTCGCCACCAGCATCGTGCCGATGGGCAGGATACATCACTA
TGCGGCGACCGGCAGATCCATTCCGGAGGGCTGGGCGCGCGATGCGGCCGGCAACCCGACGACCGACCCGCGGCGTGCCA
AGGCCGGCGCGATCGCGCCCTTCGGAGATGCGAAGGGCTATGGCCTCGGCCTTGCCATCGAGCTGCTGGTGGCGGCCCTT
GCAGGTTCCGCGCTCGCACCGGACGTGCACGGCACGCTCGACAGCCAATCGCCATGCAACCAGGGTGACGTCTTCATCCT
GATCGAACCCAGTCTGGCGCCGGGCCTCGCCGCGCGCCTGTCAGCCTATCTCGCTGCCGTGCGCGCCTCACCATCCGAGA
TTGCTGGCGAGCCGGTTCTCGTCCCCGGCGATCGTGCCCGTCAGCGGCGGGCGGCTGCCCGCCGCAACGGTTTTGAGATC
GACCAATGCCTCTGGGAAGACCTCAACGCGCTTTCCTCCTCCCGCATTCTGGCCTTCGAGGGACAAGGATCATGA

Upstream 100 bases:

>100_bases
TCATCTGCTGCCTTGCCTCTTGACAGCTTCAATCGCTAGCACGATGCTGCGTCCGAGACAATCCTATATCCTATACGATT
TAATATAGGGAGGAAAAATC

Downstream 100 bases:

>100_bases
GCCTGTTTGCCGCCTTGAGGCTGCCGCGGGAGATCCTGTTCGGTATCGGCCAGCGCCATGCGCTCGCGAGCGTCGCCAGC
AGGACCGGCCGGCGCGCGCT

Product: putative malate dehydrogenase protein

Products: NA

Alternate protein names: (R)-2-hydroxyacid dehydrogenase; (R)-sulfolactate dehydrogenase [H]

Number of amino acids: Translated: 344; Mature: 344

Protein sequence:

>344_residues
MRVAEAEALALATHVLEEHGAPPDHAALQARVLVTAEMKGHPSHGLYRLPLLVERIERGVVDPQSKGTQRWRADAVLEVE
GSAGFGPVVAQTGIERLAPHIPDLGIGLVTVRNANHLGMLAHYVETISAMGFVGIALSSSEALVHPYGGTRAMLGTNPIA
IGVPTAADPLVLDLATSIVPMGRIHHYAATGRSIPEGWARDAAGNPTTDPRRAKAGAIAPFGDAKGYGLGLAIELLVAAL
AGSALAPDVHGTLDSQSPCNQGDVFILIEPSLAPGLAARLSAYLAAVRASPSEIAGEPVLVPGDRARQRRAAARRNGFEI
DQCLWEDLNALSSSRILAFEGQGS

Sequences:

>Translated_344_residues
MRVAEAEALALATHVLEEHGAPPDHAALQARVLVTAEMKGHPSHGLYRLPLLVERIERGVVDPQSKGTQRWRADAVLEVE
GSAGFGPVVAQTGIERLAPHIPDLGIGLVTVRNANHLGMLAHYVETISAMGFVGIALSSSEALVHPYGGTRAMLGTNPIA
IGVPTAADPLVLDLATSIVPMGRIHHYAATGRSIPEGWARDAAGNPTTDPRRAKAGAIAPFGDAKGYGLGLAIELLVAAL
AGSALAPDVHGTLDSQSPCNQGDVFILIEPSLAPGLAARLSAYLAAVRASPSEIAGEPVLVPGDRARQRRAAARRNGFEI
DQCLWEDLNALSSSRILAFEGQGS
>Mature_344_residues
MRVAEAEALALATHVLEEHGAPPDHAALQARVLVTAEMKGHPSHGLYRLPLLVERIERGVVDPQSKGTQRWRADAVLEVE
GSAGFGPVVAQTGIERLAPHIPDLGIGLVTVRNANHLGMLAHYVETISAMGFVGIALSSSEALVHPYGGTRAMLGTNPIA
IGVPTAADPLVLDLATSIVPMGRIHHYAATGRSIPEGWARDAAGNPTTDPRRAKAGAIAPFGDAKGYGLGLAIELLVAAL
AGSALAPDVHGTLDSQSPCNQGDVFILIEPSLAPGLAARLSAYLAAVRASPSEIAGEPVLVPGDRARQRRAAARRNGFEI
DQCLWEDLNALSSSRILAFEGQGS

Specific function: Catalyzes the reduction of sulfopyruvate to (R)- sulfolactate much more efficiently than the reverse reaction. Also catalyzes the reduction of oxaloacetate, alpha-ketoglutarate, and to a much lower extent, KHTCA, but not pyruvate. Involved in the biosynth

COG id: COG2055

COG function: function code C; Malate/L-lactate dehydrogenases

Gene ontology:

Cell location: Cytoplasm [H]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the LDH2/MDH2 oxidoreductase family [H]

Homologues:

Organism=Escherichia coli, GI1786727, Length=337, Percent_Identity=29.673590504451, Blast_Score=131, Evalue=5e-32,
Organism=Escherichia coli, GI1787020, Length=326, Percent_Identity=29.7546012269939, Blast_Score=126, Evalue=2e-30,
Organism=Escherichia coli, GI1790000, Length=335, Percent_Identity=26.2686567164179, Blast_Score=121, Evalue=7e-29,
Organism=Caenorhabditis elegans, GI17536633, Length=324, Percent_Identity=29.9382716049383, Blast_Score=147, Evalue=1e-35,
Organism=Caenorhabditis elegans, GI17507179, Length=322, Percent_Identity=28.8819875776398, Blast_Score=142, Evalue=2e-34,
Organism=Drosophila melanogaster, GI24667908, Length=319, Percent_Identity=29.4670846394984, Blast_Score=141, Evalue=7e-34,
Organism=Drosophila melanogaster, GI45553211, Length=319, Percent_Identity=29.4670846394984, Blast_Score=141, Evalue=8e-34,
Organism=Drosophila melanogaster, GI24667912, Length=319, Percent_Identity=29.4670846394984, Blast_Score=141, Evalue=8e-34,
Organism=Drosophila melanogaster, GI24667904, Length=319, Percent_Identity=29.4670846394984, Blast_Score=141, Evalue=8e-34,
Organism=Drosophila melanogaster, GI24658010, Length=303, Percent_Identity=26.7326732673267, Blast_Score=113, Evalue=2e-25,
Organism=Drosophila melanogaster, GI24648360, Length=337, Percent_Identity=25.8160237388724, Blast_Score=103, Evalue=1e-22,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR003767 [H]

Pfam domain/function: PF02615 Ldh_2 [H]

EC number: =1.1.1.272 [H]

Molecular weight: Translated: 35866; Mature: 35866

Theoretical pI: Translated: 6.37; Mature: 6.37

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.6 %Cys     (Translated Protein)
1.7 %Met     (Translated Protein)
2.3 %Cys+Met (Translated Protein)
0.6 %Cys     (Mature Protein)
1.7 %Met     (Mature Protein)
2.3 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MRVAEAEALALATHVLEEHGAPPDHAALQARVLVTAEMKGHPSHGLYRLPLLVERIERGV
CCCCHHHHHHHHHHHHHHCCCCCCHHHEEEEEEEEEECCCCCCCCEEHHHHHHHHHHHCC
VDPQSKGTQRWRADAVLEVEGSAGFGPVVAQTGIERLAPHIPDLGIGLVTVRNANHLGML
CCCCCCCCHHHCCCEEEEECCCCCCCHHHHHHHHHHHHCCCCCCCCEEEEEECCCHHHHH
AHYVETISAMGFVGIALSSSEALVHPYGGTRAMLGTNPIAIGVPTAADPLVLDLATSIVP
HHHHHHHHHHHHEEEEECCCCEEEECCCCCEEEECCCCEEEECCCCCCHHHHHHHHHHHH
MGRIHHYAATGRSIPEGWARDAAGNPTTDPRRAKAGAIAPFGDAKGYGLGLAIELLVAAL
HHHHHHHHHCCCCCCCHHHHCCCCCCCCCCCHHCCCCCCCCCCCCCCCHHHHHHHHHHHH
AGSALAPDVHGTLDSQSPCNQGDVFILIEPSLAPGLAARLSAYLAAVRASPSEIAGEPVL
HCCCCCCCCCCCCCCCCCCCCCCEEEEECCCCCCHHHHHHHHHHHHHHCCHHHHCCCCEE
VPGDRARQRRAAARRNGFEIDQCLWEDLNALSSSRILAFEGQGS
CCCHHHHHHHHHHHHCCCCHHHHHHHHHHHHCCCCEEEEECCCC
>Mature Secondary Structure
MRVAEAEALALATHVLEEHGAPPDHAALQARVLVTAEMKGHPSHGLYRLPLLVERIERGV
CCCCHHHHHHHHHHHHHHCCCCCCHHHEEEEEEEEEECCCCCCCCEEHHHHHHHHHHHCC
VDPQSKGTQRWRADAVLEVEGSAGFGPVVAQTGIERLAPHIPDLGIGLVTVRNANHLGML
CCCCCCCCHHHCCCEEEEECCCCCCCHHHHHHHHHHHHCCCCCCCCEEEEEECCCHHHHH
AHYVETISAMGFVGIALSSSEALVHPYGGTRAMLGTNPIAIGVPTAADPLVLDLATSIVP
HHHHHHHHHHHHEEEEECCCCEEEECCCCCEEEECCCCEEEECCCCCCHHHHHHHHHHHH
MGRIHHYAATGRSIPEGWARDAAGNPTTDPRRAKAGAIAPFGDAKGYGLGLAIELLVAAL
HHHHHHHHHCCCCCCCHHHHCCCCCCCCCCCHHCCCCCCCCCCCCCCCHHHHHHHHHHHH
AGSALAPDVHGTLDSQSPCNQGDVFILIEPSLAPGLAARLSAYLAAVRASPSEIAGEPVL
HCCCCCCCCCCCCCCCCCCCCCCEEEEECCCCCCHHHHHHHHHHHHHHCCHHHHCCCCEE
VPGDRARQRRAAARRNGFEIDQCLWEDLNALSSSRILAFEGQGS
CCCHHHHHHHHHHHHCCCCHHHHHHHHHHHHCCCCEEEEECCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: 8688087; 10850983 [H]