| Definition | Rhizobium leguminosarum bv. viciae 3841 plasmid pRL12, complete sequence. |
|---|---|
| Accession | NC_008378 |
| Length | 870,021 |
Click here to switch to the map view.
The map label for this gene is comC [H]
Identifier: 116249266
GI number: 116249266
Start: 652001
End: 653035
Strand: Direct
Name: comC [H]
Synonym: pRL120601
Alternate gene names: 116249266
Gene position: 652001-653035 (Clockwise)
Preceding gene: 116249263
Following gene: 116249267
Centisome position: 74.94
GC content: 68.99
Gene sequence:
>1035_bases ATGCGCGTATCCGAAACGGCAGCGCTTGCGCTTGCCACCCGCCTGCTGGAAGAGCATGGCGCACCGCGTGACCATGCGGC CCTGCAGGCTCGCGTCCTGGTAACGGCGGAGATGAAGGGGCACCCCTCGCATGGCCTGTACCGGCTTCCGCGGCTGGTCG AACGGATCGAGCGCGGGGTCATTGACCCGCAGACGAAGGGCACCCAGCGCTGGCGCGCGGATGCGGTGCTGGAGGTGGAG GGTTCGTCGGGATTTGGCCCCGTCGTCGCCATGGCCGCGATCGAGCGGCTAGCGCCTCACATTCCGGATCTTGGCATCGG CCTTGTCGCCGTGCGCAATGCCAACCATCTCGGCATGCTTGCGCAGTATGTGGAGGCCATCGCCGCAATGGGTTTCGTCG GCATCGCGCTCTCGTCGAGCGAGGCGCTGGTCCATCCCTTCGGCGGTACCCGGGCCATGCTCGGCACCAATCCCATCGCC ATCGCCGTGCCCACGGCCGAGGAACCGCTCGTGCTCGACCTGGCCACCAGCCTCGTGCCGATGGGCAGGATCCATCATCA CGCGGCGACCGGCAGACCCATTCCCGAGGGATGGGCGCGCGATGCGGCCGGCAACCCGACGACCGATCCGGGGCGTGCGA AGGCCGGCGCGATTGCGCCCTTCGGCGACGCGAAGGGCTACGGGCTCGGCATAGCCATGGAGCTGCTGGTGGCAGCTCTT GCCGGCTCGGCGCTCGCGCCGGATGTGCGCGGCACGCTCGACAGCCAGTCGCCATGCAACAAGGGCGACGTCTTCATCTT GATCGAGCCCAGTCTGGCGCCGGGACTGCCGGCGCGACTGTCGACCTATCTCGATGCCGTGCGCGGTTCACCACCCGCCG GCGCTGGCGAACCGGTTCTCGTCCCGGGCGATCGTGCCCGCCGGCGGCGGGCGGCGGCGAGCCGCAACGGGTTCGAGATC GACCAGCGCCTCTGGGAAGACCTCAACGCGCTTTCGCGCCCTCGCATTCTGGCCTTCGAGGGACAAGGATCATGA
Upstream 100 bases:
>100_bases TCATCTGCTGCCTTGCCTCTTGACAGGTTCAATCGCTAGCACGATGCTGCGGCCAAGACAATCCTATATCCTATACGATT TAATATAGGGAGGAAAAATC
Downstream 100 bases:
>100_bases GCCTCTTTGCCGCCCTGAGGCTGCCGCAGGAAATCCTGTTTGGCGTCGGCCAGCGCCATGCGCTCGCGAGCGTCGCCAGC AGAACCGGCCGGCGCGCACT
Product: putative L-lactate dehydrogenase family protein
Products: NA
Alternate protein names: (R)-2-hydroxyacid dehydrogenase; (R)-sulfolactate dehydrogenase [H]
Number of amino acids: Translated: 344; Mature: 344
Protein sequence:
>344_residues MRVSETAALALATRLLEEHGAPRDHAALQARVLVTAEMKGHPSHGLYRLPRLVERIERGVIDPQTKGTQRWRADAVLEVE GSSGFGPVVAMAAIERLAPHIPDLGIGLVAVRNANHLGMLAQYVEAIAAMGFVGIALSSSEALVHPFGGTRAMLGTNPIA IAVPTAEEPLVLDLATSLVPMGRIHHHAATGRPIPEGWARDAAGNPTTDPGRAKAGAIAPFGDAKGYGLGIAMELLVAAL AGSALAPDVRGTLDSQSPCNKGDVFILIEPSLAPGLPARLSTYLDAVRGSPPAGAGEPVLVPGDRARRRRAAASRNGFEI DQRLWEDLNALSRPRILAFEGQGS
Sequences:
>Translated_344_residues MRVSETAALALATRLLEEHGAPRDHAALQARVLVTAEMKGHPSHGLYRLPRLVERIERGVIDPQTKGTQRWRADAVLEVE GSSGFGPVVAMAAIERLAPHIPDLGIGLVAVRNANHLGMLAQYVEAIAAMGFVGIALSSSEALVHPFGGTRAMLGTNPIA IAVPTAEEPLVLDLATSLVPMGRIHHHAATGRPIPEGWARDAAGNPTTDPGRAKAGAIAPFGDAKGYGLGIAMELLVAAL AGSALAPDVRGTLDSQSPCNKGDVFILIEPSLAPGLPARLSTYLDAVRGSPPAGAGEPVLVPGDRARRRRAAASRNGFEI DQRLWEDLNALSRPRILAFEGQGS >Mature_344_residues MRVSETAALALATRLLEEHGAPRDHAALQARVLVTAEMKGHPSHGLYRLPRLVERIERGVIDPQTKGTQRWRADAVLEVE GSSGFGPVVAMAAIERLAPHIPDLGIGLVAVRNANHLGMLAQYVEAIAAMGFVGIALSSSEALVHPFGGTRAMLGTNPIA IAVPTAEEPLVLDLATSLVPMGRIHHHAATGRPIPEGWARDAAGNPTTDPGRAKAGAIAPFGDAKGYGLGIAMELLVAAL AGSALAPDVRGTLDSQSPCNKGDVFILIEPSLAPGLPARLSTYLDAVRGSPPAGAGEPVLVPGDRARRRRAAASRNGFEI DQRLWEDLNALSRPRILAFEGQGS
Specific function: Catalyzes the reduction of sulfopyruvate to (R)- sulfolactate much more efficiently than the reverse reaction. Also catalyzes the reduction of oxaloacetate, alpha-ketoglutarate, and to a much lower extent, KHTCA, but not pyruvate. Involved in the biosynth
COG id: COG2055
COG function: function code C; Malate/L-lactate dehydrogenases
Gene ontology:
Cell location: Cytoplasm [H]
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the LDH2/MDH2 oxidoreductase family [H]
Homologues:
Organism=Escherichia coli, GI1790000, Length=335, Percent_Identity=28.6567164179104, Blast_Score=137, Evalue=1e-33, Organism=Escherichia coli, GI1786727, Length=335, Percent_Identity=29.5522388059701, Blast_Score=135, Evalue=3e-33, Organism=Escherichia coli, GI1787020, Length=333, Percent_Identity=29.7297297297297, Blast_Score=129, Evalue=3e-31, Organism=Caenorhabditis elegans, GI17536633, Length=316, Percent_Identity=29.746835443038, Blast_Score=147, Evalue=6e-36, Organism=Caenorhabditis elegans, GI17507179, Length=322, Percent_Identity=30.1242236024845, Blast_Score=147, Evalue=1e-35, Organism=Drosophila melanogaster, GI45553211, Length=300, Percent_Identity=31.6666666666667, Blast_Score=145, Evalue=5e-35, Organism=Drosophila melanogaster, GI24667912, Length=300, Percent_Identity=31.6666666666667, Blast_Score=145, Evalue=5e-35, Organism=Drosophila melanogaster, GI24667908, Length=300, Percent_Identity=31.6666666666667, Blast_Score=145, Evalue=6e-35, Organism=Drosophila melanogaster, GI24667904, Length=300, Percent_Identity=31.6666666666667, Blast_Score=144, Evalue=6e-35, Organism=Drosophila melanogaster, GI24658010, Length=310, Percent_Identity=27.741935483871, Blast_Score=119, Evalue=2e-27, Organism=Drosophila melanogaster, GI24648360, Length=315, Percent_Identity=25.3968253968254, Blast_Score=107, Evalue=1e-23,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR003767 [H]
Pfam domain/function: PF02615 Ldh_2 [H]
EC number: =1.1.1.272 [H]
Molecular weight: Translated: 36001; Mature: 36001
Theoretical pI: Translated: 7.40; Mature: 7.40
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.3 %Cys (Translated Protein) 2.3 %Met (Translated Protein) 2.6 %Cys+Met (Translated Protein) 0.3 %Cys (Mature Protein) 2.3 %Met (Mature Protein) 2.6 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MRVSETAALALATRLLEEHGAPRDHAALQARVLVTAEMKGHPSHGLYRLPRLVERIERGV CCCCHHHHHHHHHHHHHHCCCCCHHHHHEEEEEEEEECCCCCCCCHHHHHHHHHHHHHCC IDPQTKGTQRWRADAVLEVEGSSGFGPVVAMAAIERLAPHIPDLGIGLVAVRNANHLGML CCCCCCCCHHHCCCEEEEECCCCCCHHHHHHHHHHHHHCCCCCCCCEEEEEECCCHHHHH AQYVEAIAAMGFVGIALSSSEALVHPFGGTRAMLGTNPIAIAVPTAEEPLVLDLATSLVP HHHHHHHHHHHHHHEEECCCCCEEECCCCCEEEECCCCEEEEECCCCCCEEHHHHHHHHH MGRIHHHAATGRPIPEGWARDAAGNPTTDPGRAKAGAIAPFGDAKGYGLGIAMELLVAAL HHHHHHHHCCCCCCCCCHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHH AGSALAPDVRGTLDSQSPCNKGDVFILIEPSLAPGLPARLSTYLDAVRGSPPAGAGEPVL HCCCCCCCHHCCCCCCCCCCCCCEEEEECCCCCCCCHHHHHHHHHHHCCCCCCCCCCCEE VPGDRARRRRAAASRNGFEIDQRLWEDLNALSRPRILAFEGQGS ECCHHHHHHHHHHCCCCCHHHHHHHHHHHHHCCCEEEEECCCCC >Mature Secondary Structure MRVSETAALALATRLLEEHGAPRDHAALQARVLVTAEMKGHPSHGLYRLPRLVERIERGV CCCCHHHHHHHHHHHHHHCCCCCHHHHHEEEEEEEEECCCCCCCCHHHHHHHHHHHHHCC IDPQTKGTQRWRADAVLEVEGSSGFGPVVAMAAIERLAPHIPDLGIGLVAVRNANHLGML CCCCCCCCHHHCCCEEEEECCCCCCHHHHHHHHHHHHHCCCCCCCCEEEEEECCCHHHHH AQYVEAIAAMGFVGIALSSSEALVHPFGGTRAMLGTNPIAIAVPTAEEPLVLDLATSLVP HHHHHHHHHHHHHHEEECCCCCEEECCCCCEEEECCCCEEEEECCCCCCEEHHHHHHHHH MGRIHHHAATGRPIPEGWARDAAGNPTTDPGRAKAGAIAPFGDAKGYGLGIAMELLVAAL HHHHHHHHCCCCCCCCCHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHH AGSALAPDVRGTLDSQSPCNKGDVFILIEPSLAPGLPARLSTYLDAVRGSPPAGAGEPVL HCCCCCCCHHCCCCCCCCCCCCCEEEEECCCCCCCCHHHHHHHHHHHCCCCCCCCCCCEE VPGDRARRRRAAASRNGFEIDQRLWEDLNALSRPRILAFEGQGS ECCHHHHHHHHHHCCCCCHHHHHHHHHHHHHCCCEEEEECCCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 10.0
TargetDB status: NA
Availability: NA
References: 8688087; 10850983 [H]