| Definition | Agrobacterium vitis S4 plasmid pAtS4e, complete sequence. |
|---|---|
| Accession | NC_011981 |
| Length | 631,775 |
Click here to switch to the map view.
The map label for this gene is mdh [C]
Identifier: 222102420
GI number: 222102420
Start: 11936
End: 12985
Strand: Reverse
Name: mdh [C]
Synonym: Avi_7014
Alternate gene names: 222102420
Gene position: 12985-11936 (Counterclockwise)
Preceding gene: 222102429
Following gene: 222102419
Centisome position: 2.06
GC content: 61.14
Gene sequence:
>1050_bases ATGACATTGAAAACGAATTTCGCAGCGGGAACCTGCCGCCTGCCGTTCGAAGCCCTTCAGAACCTCCTCAAGCGCATTTT CCTGGCGGCTGGAGCCAGCGAGCACGTGGCGAACATCCTCAGCGCCAATTGTGCTGGATGCGAACGCGATGGCGCGCTTT CACATGGCATTTTCAGAATGCCCGGCTATGTAAGTTCCATCCGCAGCGGTTGGGTCGATCCTGCCGCCGTGCCGGTTCTG GAGACCGGTGGCTCGGGCTTCCTGCGGGTTGATGCCCGTAACGGATTTACGCAGGTCGCGCTCGATTTTGCGGCACAGTC TTTGAAGGAGCGCGCAAGGCAGGAAGGCATCGCGCTGCTTTCGATCCGCAATTCCCATCATTTCAGCGCGCTCTGGCCGG ATGTCGTGCCCTTCGCCGAAGAGCGGCTACTGGCCATCGCGATGGTCAACAGCTTTGCCTGTACCGCGCCTTTCGATGCC AAGGTGCCGGTTTTCGGCACCAATCCGGTTGCCTTTGCCGCGCCCTGTGACGGCATGGTCCCCATGGTCGTCGATATGGC CACGAGCGCCATCGCCAATGGCGATGTGCAGATTGCCGCGCGCGAAGGCTTCAGCCTGCCGCCTGGGCTAGGCATCGACC GGAGCGGAAAGCCAACCGTCGATCCGCATGCGGTGCTGGATGGCGGCGCACTGCTGACATTCGGCGGCTATAAGGGCTCG GCCATTTCGATGCTGGTGGAAGTGATGAGCGCCGCTTTGACCGGAGGCAAGTTTTCCTACGAAGTGGACTGGTCCGACTA TCCCGGGGCACAGACGCCGCATACGGGCCAGCTCGTTATTCTGATCGATCCGGATGTTGGCCGCAATGCGCAATTCAGCC GCCGCGTCCGGCATCTGGTCGAACGGCTCCGACTGGCAAAGGTCTCTCGCCTGCCAGGCGATCGCCGGCTGGTCACACGC GAGCGTTCGATGCGGGAGGGCGTGTGCCTACAAAAGAGCGATCTGGAGAGAATGGAACTTCTAGCGCAGCAAAGATGGGC ATCAACCTGA
Upstream 100 bases:
>100_bases TCGAACAAACTTTACTCATAGGCGGTCAAGGAATAATCCGCTTGTGATTACATCATTTCGCGCCTATCTTTCCTATAAGA AACATTTGCGAAGTTGCCCT
Downstream 100 bases:
>100_bases TGTCGCGGAGCGGGGATCAGGTTGATCCTTGCAGAAGTTGCGGCTCTGTGGCATGGGCCATCGGAAGTTACATAAGAAAC AATGTCTACAAGTGATGCAC
Product: malate dehydrogenase
Products: oxaloacetate; NADH; H+
Alternate protein names: NA
Number of amino acids: Translated: 349; Mature: 348
Protein sequence:
>349_residues MTLKTNFAAGTCRLPFEALQNLLKRIFLAAGASEHVANILSANCAGCERDGALSHGIFRMPGYVSSIRSGWVDPAAVPVL ETGGSGFLRVDARNGFTQVALDFAAQSLKERARQEGIALLSIRNSHHFSALWPDVVPFAEERLLAIAMVNSFACTAPFDA KVPVFGTNPVAFAAPCDGMVPMVVDMATSAIANGDVQIAAREGFSLPPGLGIDRSGKPTVDPHAVLDGGALLTFGGYKGS AISMLVEVMSAALTGGKFSYEVDWSDYPGAQTPHTGQLVILIDPDVGRNAQFSRRVRHLVERLRLAKVSRLPGDRRLVTR ERSMREGVCLQKSDLERMELLAQQRWAST
Sequences:
>Translated_349_residues MTLKTNFAAGTCRLPFEALQNLLKRIFLAAGASEHVANILSANCAGCERDGALSHGIFRMPGYVSSIRSGWVDPAAVPVL ETGGSGFLRVDARNGFTQVALDFAAQSLKERARQEGIALLSIRNSHHFSALWPDVVPFAEERLLAIAMVNSFACTAPFDA KVPVFGTNPVAFAAPCDGMVPMVVDMATSAIANGDVQIAAREGFSLPPGLGIDRSGKPTVDPHAVLDGGALLTFGGYKGS AISMLVEVMSAALTGGKFSYEVDWSDYPGAQTPHTGQLVILIDPDVGRNAQFSRRVRHLVERLRLAKVSRLPGDRRLVTR ERSMREGVCLQKSDLERMELLAQQRWAST >Mature_348_residues TLKTNFAAGTCRLPFEALQNLLKRIFLAAGASEHVANILSANCAGCERDGALSHGIFRMPGYVSSIRSGWVDPAAVPVLE TGGSGFLRVDARNGFTQVALDFAAQSLKERARQEGIALLSIRNSHHFSALWPDVVPFAEERLLAIAMVNSFACTAPFDAK VPVFGTNPVAFAAPCDGMVPMVVDMATSAIANGDVQIAAREGFSLPPGLGIDRSGKPTVDPHAVLDGGALLTFGGYKGSA ISMLVEVMSAALTGGKFSYEVDWSDYPGAQTPHTGQLVILIDPDVGRNAQFSRRVRHLVERLRLAKVSRLPGDRRLVTRE RSMREGVCLQKSDLERMELLAQQRWAST
Specific function: Unknown
COG id: COG2055
COG function: function code C; Malate/L-lactate dehydrogenases
Gene ontology:
Cell location: Cytoplasm (Potential) [H]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the LDH2/MDH2 oxidoreductase family [H]
Homologues:
Organism=Escherichia coli, GI1787020, Length=329, Percent_Identity=29.1793313069909, Blast_Score=132, Evalue=2e-32, Organism=Escherichia coli, GI1786727, Length=305, Percent_Identity=30.8196721311475, Blast_Score=111, Evalue=8e-26, Organism=Escherichia coli, GI1790000, Length=342, Percent_Identity=26.0233918128655, Blast_Score=104, Evalue=7e-24, Organism=Caenorhabditis elegans, GI17507179, Length=346, Percent_Identity=28.9017341040462, Blast_Score=120, Evalue=1e-27, Organism=Caenorhabditis elegans, GI17536633, Length=295, Percent_Identity=26.7796610169492, Blast_Score=105, Evalue=4e-23, Organism=Drosophila melanogaster, GI24667904, Length=263, Percent_Identity=27.7566539923954, Blast_Score=112, Evalue=4e-25, Organism=Drosophila melanogaster, GI24667908, Length=291, Percent_Identity=26.8041237113402, Blast_Score=112, Evalue=5e-25, Organism=Drosophila melanogaster, GI45553211, Length=291, Percent_Identity=26.8041237113402, Blast_Score=111, Evalue=6e-25, Organism=Drosophila melanogaster, GI24667912, Length=291, Percent_Identity=26.8041237113402, Blast_Score=111, Evalue=6e-25, Organism=Drosophila melanogaster, GI24648360, Length=311, Percent_Identity=24.7588424437299, Blast_Score=80, Evalue=2e-15, Organism=Drosophila melanogaster, GI24658010, Length=338, Percent_Identity=21.301775147929, Blast_Score=65, Evalue=5e-11,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR003767 [H]
Pfam domain/function: PF02615 Ldh_2 [H]
EC number: 1.1.1.37
Molecular weight: Translated: 37538; Mature: 37406
Theoretical pI: Translated: 8.14; Mature: 8.14
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.7 %Cys (Translated Protein) 2.9 %Met (Translated Protein) 4.6 %Cys+Met (Translated Protein) 1.7 %Cys (Mature Protein) 2.6 %Met (Mature Protein) 4.3 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MTLKTNFAAGTCRLPFEALQNLLKRIFLAAGASEHVANILSANCAGCERDGALSHGIFRM CCEECCCCCCEECCCHHHHHHHHHHHHHHCCCHHHHHHHHHCCCCCCCCCCCCCCCCCCC PGYVSSIRSGWVDPAAVPVLETGGSGFLRVDARNGFTQVALDFAAQSLKERARQEGIALL CCHHHHHHHCCCCCCCCCEEECCCCCEEEEECCCCHHHHHHHHHHHHHHHHHHHCCEEEE SIRNSHHFSALWPDVVPFAEERLLAIAMVNSFACTAPFDAKVPVFGTNPVAFAAPCDGMV EEECCCCCHHHCCCHHHHHHHHHHHHHHHHCCEECCCCCCCCCEECCCCEEEECCCCCCH PMVVDMATSAIANGDVQIAAREGFSLPPGLGIDRSGKPTVDPHAVLDGGALLTFGGYKGS HHHHHHHHHHHCCCCEEEEECCCCCCCCCCCCCCCCCCCCCCCEEECCCEEEEECCCCCH AISMLVEVMSAALTGGKFSYEVDWSDYPGAQTPHTGQLVILIDPDVGRNAQFSRRVRHLV HHHHHHHHHHHHHCCCCEEEEECCCCCCCCCCCCCCEEEEEECCCCCCCCHHHHHHHHHH ERLRLAKVSRLPGDRRLVTRERSMREGVCLQKSDLERMELLAQQRWAST HHHHHHHHHCCCCCCHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHCCC >Mature Secondary Structure TLKTNFAAGTCRLPFEALQNLLKRIFLAAGASEHVANILSANCAGCERDGALSHGIFRM CEECCCCCCEECCCHHHHHHHHHHHHHHCCCHHHHHHHHHCCCCCCCCCCCCCCCCCCC PGYVSSIRSGWVDPAAVPVLETGGSGFLRVDARNGFTQVALDFAAQSLKERARQEGIALL CCHHHHHHHCCCCCCCCCEEECCCCCEEEEECCCCHHHHHHHHHHHHHHHHHHHCCEEEE SIRNSHHFSALWPDVVPFAEERLLAIAMVNSFACTAPFDAKVPVFGTNPVAFAAPCDGMV EEECCCCCHHHCCCHHHHHHHHHHHHHHHHCCEECCCCCCCCCEECCCCEEEECCCCCCH PMVVDMATSAIANGDVQIAAREGFSLPPGLGIDRSGKPTVDPHAVLDGGALLTFGGYKGS HHHHHHHHHHHCCCCEEEEECCCCCCCCCCCCCCCCCCCCCCCEEECCCEEEEECCCCCH AISMLVEVMSAALTGGKFSYEVDWSDYPGAQTPHTGQLVILIDPDVGRNAQFSRRVRHLV HHHHHHHHHHHHHCCCCEEEEECCCCCCCCCCCCCCEEEEEECCCCCCCCHHHHHHHHHH ERLRLAKVSRLPGDRRLVTRERSMREGVCLQKSDLERMELLAQQRWAST HHHHHHHHHCCCCCCHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: (S)-malate; NAD+
Specific reaction: (S)-malate + NAD+ = oxaloacetate + NADH + H+
General reaction: NA
Inhibitor: NA
Structure determination priority: 10.0
TargetDB status: NA
Availability: NA
References: 10984043 [H]