| Definition | Clostridium acetobutylicum ATCC 824 plasmid pSOL1, complete sequence. |
|---|---|
| Accession | NC_001988 |
| Length | 192,000 |
Click here to switch to the map view.
The map label for this gene is adhe1
Identifier: 15004865
GI number: 15004865
Start: 175810
End: 178398
Strand: Direct
Name: adhe1
Synonym: CA_P0162
Alternate gene names: 15004865
Gene position: 175810-178398 (Clockwise)
Preceding gene: 15004864
Following gene: 15004866
Centisome position: 91.57
GC content: 34.8
Gene sequence:
>2589_bases ATGAAAGTCACAACAGTAAAGGAATTAGATGAAAAACTCAAGGTAATTAAAGAAGCTCAAAAAAAATTCTCTTGTTACTC GCAAGAAATGGTTGATGAAATCTTTAGAAATGCAGCAATGGCAGCAATCGACGCAAGGATAGAGCTAGCAAAAGCAGCTG TTTTGGAAACCGGTATGGGCTTAGTTGAAGACAAGGTTATAAAAAATCATTTTGCAGGCGAATACATCTATAACAAATAT AAGGATGAAAAAACCTGCGGTATAATTGAACGAAATGAACCCTACGGAATTACAAAAATAGCAGAACCTATAGGAGTTGT AGCTGCTATAATCCCTGTAACAAACCCCACATCAACAACAATATTTAAATCCTTAATATCCCTTAAAACTAGAAATGGAA TTTTCTTTTCGCCTCACCCAAGGGCAAAAAAATCCACAATACTAGCAGCTAAAACAATACTTGATGCAGCCGTTAAGAGT GGTGCCCCGGAAAATATAATAGGTTGGATAGATGAACCTTCAATTGAACTAACTCAATATTTAATGCAAAAAGCAGATAT AACCCTTGCAACTGGTGGTCCCTCACTAGTTAAATCTGCTTATTCTTCCGGAAAACCAGCAATAGGTGTTGGTCCGGGTA ACACCCCAGTAATAATTGATGAATCTGCTCATATAAAAATGGCAGTAAGTTCAATTATATTATCCAAAACCTATGATAAT GGTGTTATATGTGCTTCTGAACAATCTGTAATAGTCTTAAAATCCATATATAACAAGGTAAAAGATGAGTTCCAAGAAAG AGGAGCTTATATAATAAAGAAAAACGAATTGGATAAAGTCCGTGAAGTGATTTTTAAAGATGGATCCGTAAACCCTAAAA TAGTCGGACAGTCAGCTTATACTATAGCAGCTATGGCTGGCATAAAAGTACCTAAAACCACAAGAATATTAATAGGAGAA GTTACCTCCTTAGGTGAAGAAGAACCTTTTGCCCACGAAAAACTATCTCCTGTTTTGGCTATGTATGAGGCTGACAATTT TGATGATGCTTTAAAAAAAGCAGTAACTCTAATAAACTTAGGAGGCCTCGGCCATACCTCAGGAATATATGCAGATGAAA TAAAAGCACGAGATAAAATAGATAGATTTAGTAGTGCCATGAAAACCGTAAGAACCTTTGTAAATATCCCAACCTCACAA GGTGCAAGTGGAGATCTATATAATTTTAGAATACCACCTTCTTTCACGCTTGGCTGCGGATTTTGGGGAGGAAATTCTGT TTCCGAGAATGTTGGTCCAAAACATCTTTTGAATATTAAAACCGTAGCTGAAAGGAGAGAAAACATGCTTTGGTTTAGAG TTCCACATAAAGTATATTTTAAGTTCGGTTGTCTTCAATTTGCTTTAAAAGATTTAAAAGATCTAAAGAAAAAAAGAGCC TTTATAGTTACTGATAGTGACCCCTATAATTTAAACTATGTTGATTCAATAATAAAAATACTTGAGCACCTAGATATTGA TTTTAAAGTATTTAATAAGGTTGGAAGAGAAGCTGATCTTAAAACCATAAAAAAAGCAACTGAAGAAATGTCCTCCTTTA TGCCAGACACTATAATAGCTTTAGGTGGTACCCCTGAAATGAGCTCTGCAAAGCTAATGTGGGTACTATATGAACATCCA GAAGTAAAATTTGAAGATCTTGCAATAAAATTTATGGACATAAGAAAGAGAATATATACTTTCCCAAAACTCGGTAAAAA GGCTATGTTAGTTGCAATTACAACTTCTGCTGGTTCCGGTTCTGAGGTTACTCCTTTTGCTTTAGTAACTGACAATAACA CTGGAAATAAGTACATGTTAGCAGATTATGAAATGACACCAAATATGGCAATTGTAGATGCAGAACTTATGATGAAAATG CCAAAGGGATTAACCGCTTATTCAGGTATAGATGCACTAGTAAATAGTATAGAAGCATACACATCCGTATATGCTTCAGA ATACACAAACGGACTAGCACTAGAGGCAATACGATTAATATTTAAATATTTGCCTGAGGCTTACAAAAACGGAAGAACCA ATGAAAAAGCAAGAGAGAAAATGGCTCACGCTTCAACTATGGCAGGTATGGCATCCGCTAATGCATTTCTAGGTCTATGT CATTCCATGGCAATAAAATTAAGTTCAGAACACAATATTCCTAGTGGCATTGCCAATGCATTACTAATAGAAGAAGTAAT AAAATTTAACGCAGTTGATAATCCTGTAAAACAAGCCCCTTGCCCACAATATAAGTATCCAAACACCATATTTAGATATG CTCGAATTGCAGATTATATAAAGCTTGGAGGAAATACTGATGAGGAAAAGGTAGATCTCTTAATTAACAAAATACATGAA CTAAAAAAAGCTTTAAATATACCAACTTCAATAAAGGATGCAGGTGTTTTGGAGGAAAACTTCTATTCCTCCCTTGATAG AATATCTGAACTTGCACTAGATGATCAATGCACAGGCGCTAATCCTAGATTTCCTCTTACAAGTGAGATAAAAGAAATGT ATATAAATTGTTTTAAAAAACAACCTTAA
Upstream 100 bases:
>100_bases TCTATCTCCAAATCTGCTTTCAAGAATAATATCTATACTAAAAACAATATAGACATTATTTTTAAAATATAATAAATATT TTAGAAAGAAGTGTATATTT
Downstream 100 bases:
>100_bases ACCTTCATATTTCAACTACTTTTTATAATTTTAATAAAGAATTTAAAAGGAGGGATTAAAATGAACTCTAAAATAATTAG ATTTGAAAATTTAAGGTCAT
Product: bifunctional acetaldehyde-CoA/alcohol dehydrogenase
Products: NA
Alternate protein names: Alcohol dehydrogenase; ADH; Acetaldehyde dehydrogenase [acetylating]; ACDH
Number of amino acids: Translated: 862; Mature: 862
Protein sequence:
>862_residues MKVTTVKELDEKLKVIKEAQKKFSCYSQEMVDEIFRNAAMAAIDARIELAKAAVLETGMGLVEDKVIKNHFAGEYIYNKY KDEKTCGIIERNEPYGITKIAEPIGVVAAIIPVTNPTSTTIFKSLISLKTRNGIFFSPHPRAKKSTILAAKTILDAAVKS GAPENIIGWIDEPSIELTQYLMQKADITLATGGPSLVKSAYSSGKPAIGVGPGNTPVIIDESAHIKMAVSSIILSKTYDN GVICASEQSVIVLKSIYNKVKDEFQERGAYIIKKNELDKVREVIFKDGSVNPKIVGQSAYTIAAMAGIKVPKTTRILIGE VTSLGEEEPFAHEKLSPVLAMYEADNFDDALKKAVTLINLGGLGHTSGIYADEIKARDKIDRFSSAMKTVRTFVNIPTSQ GASGDLYNFRIPPSFTLGCGFWGGNSVSENVGPKHLLNIKTVAERRENMLWFRVPHKVYFKFGCLQFALKDLKDLKKKRA FIVTDSDPYNLNYVDSIIKILEHLDIDFKVFNKVGREADLKTIKKATEEMSSFMPDTIIALGGTPEMSSAKLMWVLYEHP EVKFEDLAIKFMDIRKRIYTFPKLGKKAMLVAITTSAGSGSEVTPFALVTDNNTGNKYMLADYEMTPNMAIVDAELMMKM PKGLTAYSGIDALVNSIEAYTSVYASEYTNGLALEAIRLIFKYLPEAYKNGRTNEKAREKMAHASTMAGMASANAFLGLC HSMAIKLSSEHNIPSGIANALLIEEVIKFNAVDNPVKQAPCPQYKYPNTIFRYARIADYIKLGGNTDEEKVDLLINKIHE LKKALNIPTSIKDAGVLEENFYSSLDRISELALDDQCTGANPRFPLTSEIKEMYINCFKKQP
Sequences:
>Translated_862_residues MKVTTVKELDEKLKVIKEAQKKFSCYSQEMVDEIFRNAAMAAIDARIELAKAAVLETGMGLVEDKVIKNHFAGEYIYNKY KDEKTCGIIERNEPYGITKIAEPIGVVAAIIPVTNPTSTTIFKSLISLKTRNGIFFSPHPRAKKSTILAAKTILDAAVKS GAPENIIGWIDEPSIELTQYLMQKADITLATGGPSLVKSAYSSGKPAIGVGPGNTPVIIDESAHIKMAVSSIILSKTYDN GVICASEQSVIVLKSIYNKVKDEFQERGAYIIKKNELDKVREVIFKDGSVNPKIVGQSAYTIAAMAGIKVPKTTRILIGE VTSLGEEEPFAHEKLSPVLAMYEADNFDDALKKAVTLINLGGLGHTSGIYADEIKARDKIDRFSSAMKTVRTFVNIPTSQ GASGDLYNFRIPPSFTLGCGFWGGNSVSENVGPKHLLNIKTVAERRENMLWFRVPHKVYFKFGCLQFALKDLKDLKKKRA FIVTDSDPYNLNYVDSIIKILEHLDIDFKVFNKVGREADLKTIKKATEEMSSFMPDTIIALGGTPEMSSAKLMWVLYEHP EVKFEDLAIKFMDIRKRIYTFPKLGKKAMLVAITTSAGSGSEVTPFALVTDNNTGNKYMLADYEMTPNMAIVDAELMMKM PKGLTAYSGIDALVNSIEAYTSVYASEYTNGLALEAIRLIFKYLPEAYKNGRTNEKAREKMAHASTMAGMASANAFLGLC HSMAIKLSSEHNIPSGIANALLIEEVIKFNAVDNPVKQAPCPQYKYPNTIFRYARIADYIKLGGNTDEEKVDLLINKIHE LKKALNIPTSIKDAGVLEENFYSSLDRISELALDDQCTGANPRFPLTSEIKEMYINCFKKQP >Mature_862_residues MKVTTVKELDEKLKVIKEAQKKFSCYSQEMVDEIFRNAAMAAIDARIELAKAAVLETGMGLVEDKVIKNHFAGEYIYNKY KDEKTCGIIERNEPYGITKIAEPIGVVAAIIPVTNPTSTTIFKSLISLKTRNGIFFSPHPRAKKSTILAAKTILDAAVKS GAPENIIGWIDEPSIELTQYLMQKADITLATGGPSLVKSAYSSGKPAIGVGPGNTPVIIDESAHIKMAVSSIILSKTYDN GVICASEQSVIVLKSIYNKVKDEFQERGAYIIKKNELDKVREVIFKDGSVNPKIVGQSAYTIAAMAGIKVPKTTRILIGE VTSLGEEEPFAHEKLSPVLAMYEADNFDDALKKAVTLINLGGLGHTSGIYADEIKARDKIDRFSSAMKTVRTFVNIPTSQ GASGDLYNFRIPPSFTLGCGFWGGNSVSENVGPKHLLNIKTVAERRENMLWFRVPHKVYFKFGCLQFALKDLKDLKKKRA FIVTDSDPYNLNYVDSIIKILEHLDIDFKVFNKVGREADLKTIKKATEEMSSFMPDTIIALGGTPEMSSAKLMWVLYEHP EVKFEDLAIKFMDIRKRIYTFPKLGKKAMLVAITTSAGSGSEVTPFALVTDNNTGNKYMLADYEMTPNMAIVDAELMMKM PKGLTAYSGIDALVNSIEAYTSVYASEYTNGLALEAIRLIFKYLPEAYKNGRTNEKAREKMAHASTMAGMASANAFLGLC HSMAIKLSSEHNIPSGIANALLIEEVIKFNAVDNPVKQAPCPQYKYPNTIFRYARIADYIKLGGNTDEEKVDLLINKIHE LKKALNIPTSIKDAGVLEENFYSSLDRISELALDDQCTGANPRFPLTSEIKEMYINCFKKQP
Specific function: This enzyme has probably two activities:ADH, and ACDH
COG id: COG1012
COG function: function code C; NAD-dependent aldehyde dehydrogenases
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: In the C-terminal section; belongs to the iron- containing alcohol dehydrogenase family
Homologues:
Organism=Homo sapiens, GI133922590, Length=340, Percent_Identity=25.8823529411765, Blast_Score=69, Evalue=3e-11, Organism=Escherichia coli, GI1787493, Length=862, Percent_Identity=56.3805104408353, Blast_Score=998, Evalue=0.0, Organism=Escherichia coli, GI48994951, Length=403, Percent_Identity=31.2655086848635, Blast_Score=173, Evalue=4e-44, Organism=Escherichia coli, GI1788797, Length=378, Percent_Identity=34.1269841269841, Blast_Score=169, Evalue=6e-43, Organism=Escherichia coli, GI87082107, Length=403, Percent_Identity=29.0322580645161, Blast_Score=161, Evalue=2e-40, Organism=Escherichia coli, GI1789163, Length=397, Percent_Identity=27.7078085642317, Blast_Score=160, Evalue=2e-40, Organism=Caenorhabditis elegans, GI17537053, Length=286, Percent_Identity=26.2237762237762, Blast_Score=100, Evalue=3e-21, Organism=Saccharomyces cerevisiae, GI6321181, Length=401, Percent_Identity=28.927680798005, Blast_Score=157, Evalue=9e-39, Organism=Saccharomyces cerevisiae, GI6323822, Length=321, Percent_Identity=23.6760124610592, Blast_Score=64, Evalue=9e-11,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): ADHE_CLOAB (P33744)
Other databases:
- EMBL: X72831 - EMBL: L14817 - EMBL: AE001438 - PIR: A49346 - RefSeq: NP_149325.1 - ProteinModelPortal: P33744 - GeneID: 1116167 - GenomeReviews: AE001438_GR - KEGG: cac:CA_P0162 - NMPDR: fig|272562.1.peg.160 - HOGENOM: HBG285847 - OMA: MASANAF - PhylomeDB: P33744 - ProtClustDB: PRK13805 - BioCyc: CACE272562:CAP0162-MONOMER - BRENDA: 1.1.1.1 - BRENDA: 1.2.1.10 - InterPro: IPR001670 - InterPro: IPR018211 - InterPro: IPR016161 - InterPro: IPR016163 - InterPro: IPR016162 - InterPro: IPR015590 - InterPro: IPR012079 - Gene3D: G3DSA:3.40.309.10 - Gene3D: G3DSA:3.40.605.10 - PIRSF: PIRSF000111
Pfam domain/function: PF00171 Aldedh; PF00465 Fe-ADH; SSF53720 Aldehyde_DH/Histidinol_DH
EC number: =1.1.1.1; =1.2.1.10
Molecular weight: Translated: 95322; Mature: 95322
Theoretical pI: Translated: 8.50; Mature: 8.50
Prosite motif: PS00913 ADH_IRON_1; PS00060 ADH_IRON_2
Important sites: ACT_SITE 244-244
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.0 %Cys (Translated Protein) 3.1 %Met (Translated Protein) 4.2 %Cys+Met (Translated Protein) 1.0 %Cys (Mature Protein) 3.1 %Met (Mature Protein) 4.2 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MKVTTVKELDEKLKVIKEAQKKFSCYSQEMVDEIFRNAAMAAIDARIELAKAAVLETGMG CCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCC LVEDKVIKNHFAGEYIYNKYKDEKTCGIIERNEPYGITKIAEPIGVVAAIIPVTNPTSTT HHHHHHHHHHHCCHHHHHHCCCCCCCCEEECCCCCCHHHHHHHHHHHHHEEECCCCCHHH IFKSLISLKTRNGIFFSPHPRAKKSTILAAKTILDAAVKSGAPENIIGWIDEPSIELTQY HHHHHHHHHHCCCEEECCCCCCCHHHHHHHHHHHHHHHHCCCCCCEEECCCCCCHHHHHH LMQKADITLATGGPSLVKSAYSSGKPAIGVGPGNTPVIIDESAHIKMAVSSIILSKTYDN HHHHCCEEEECCCHHHHHHHHHCCCCEEEECCCCCCEEECCCCCHHHHHHHHHHHCCCCC GVICASEQSVIVLKSIYNKVKDEFQERGAYIIKKNELDKVREVIFKDGSVNPKIVGQSAY CEEEECCCCEEHHHHHHHHHHHHHHHCCCEEEECCHHHHHHHHHHCCCCCCCEEECCCHH TIAAMAGIKVPKTTRILIGEVTSLGEEEPFAHEKLSPVLAMYEADNFDDALKKAVTLINL HHHHHHCCCCCCCHHEEEEHHHHCCCCCCCHHHHHHHHHHHHCCCCHHHHHHHHHHHHEE GGLGHTSGIYADEIKARDKIDRFSSAMKTVRTFVNIPTSQGASGDLYNFRIPPSFTLGCG CCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCEEEEECCCCCEEEEE FWGGNSVSENVGPKHLLNIKTVAERRENMLWFRVPHKVYFKFGCLQFALKDLKDLKKKRA CCCCCCCCCCCCHHHHHHHHHHHHHHHCEEEEECCHHHHHHHHHHHHHHHHHHHHHHCCE FIVTDSDPYNLNYVDSIIKILEHLDIDFKVFNKVGREADLKTIKKATEEMSSFMPDTIIA EEEECCCCCCCHHHHHHHHHHHHCCCCHHHHHHHCCHHHHHHHHHHHHHHHHHCCCEEEE LGGTPEMSSAKLMWVLYEHPEVKFEDLAIKFMDIRKRIYTFPKLGKKAMLVAITTSAGSG ECCCCCCCCCEEEEEEECCCCCCHHHHHHHHHHHHHHHHHCCCCCCCEEEEEEEECCCCC SEVTPFALVTDNNTGNKYMLADYEMTPNMAIVDAELMMKMPKGLTAYSGIDALVNSIEAY CCCCCEEEEEECCCCCEEEEEECEECCCEEEEEHHHHHHCCCCCCHHHHHHHHHHHHHHH TSVYASEYTNGLALEAIRLIFKYLPEAYKNGRTNEKAREKMAHASTMAGMASANAFLGLC HHHHHHHHCCCHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHH HSMAIKLSSEHNIPSGIANALLIEEVIKFNAVDNPVKQAPCPQYKYPNTIFRYARIADYI HHHHHEECCCCCCCHHHHHHHHHHHHHHHCCCCCCHHCCCCCCCCCCHHHHHHHHHHHHH KLGGNTDEEKVDLLINKIHELKKALNIPTSIKDAGVLEENFYSSLDRISELALDDQCTGA HCCCCCCHHHHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHHCCCCCCCC NPRFPLTSEIKEMYINCFKKQP CCCCCCHHHHHHHHHHHHCCCC >Mature Secondary Structure MKVTTVKELDEKLKVIKEAQKKFSCYSQEMVDEIFRNAAMAAIDARIELAKAAVLETGMG CCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCC LVEDKVIKNHFAGEYIYNKYKDEKTCGIIERNEPYGITKIAEPIGVVAAIIPVTNPTSTT HHHHHHHHHHHCCHHHHHHCCCCCCCCEEECCCCCCHHHHHHHHHHHHHEEECCCCCHHH IFKSLISLKTRNGIFFSPHPRAKKSTILAAKTILDAAVKSGAPENIIGWIDEPSIELTQY HHHHHHHHHHCCCEEECCCCCCCHHHHHHHHHHHHHHHHCCCCCCEEECCCCCCHHHHHH LMQKADITLATGGPSLVKSAYSSGKPAIGVGPGNTPVIIDESAHIKMAVSSIILSKTYDN HHHHCCEEEECCCHHHHHHHHHCCCCEEEECCCCCCEEECCCCCHHHHHHHHHHHCCCCC GVICASEQSVIVLKSIYNKVKDEFQERGAYIIKKNELDKVREVIFKDGSVNPKIVGQSAY CEEEECCCCEEHHHHHHHHHHHHHHHCCCEEEECCHHHHHHHHHHCCCCCCCEEECCCHH TIAAMAGIKVPKTTRILIGEVTSLGEEEPFAHEKLSPVLAMYEADNFDDALKKAVTLINL HHHHHHCCCCCCCHHEEEEHHHHCCCCCCCHHHHHHHHHHHHCCCCHHHHHHHHHHHHEE GGLGHTSGIYADEIKARDKIDRFSSAMKTVRTFVNIPTSQGASGDLYNFRIPPSFTLGCG CCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCEEEEECCCCCEEEEE FWGGNSVSENVGPKHLLNIKTVAERRENMLWFRVPHKVYFKFGCLQFALKDLKDLKKKRA CCCCCCCCCCCCHHHHHHHHHHHHHHHCEEEEECCHHHHHHHHHHHHHHHHHHHHHHCCE FIVTDSDPYNLNYVDSIIKILEHLDIDFKVFNKVGREADLKTIKKATEEMSSFMPDTIIA EEEECCCCCCCHHHHHHHHHHHHCCCCHHHHHHHCCHHHHHHHHHHHHHHHHHCCCEEEE LGGTPEMSSAKLMWVLYEHPEVKFEDLAIKFMDIRKRIYTFPKLGKKAMLVAITTSAGSG ECCCCCCCCCEEEEEEECCCCCCHHHHHHHHHHHHHHHHHCCCCCCCEEEEEEEECCCCC SEVTPFALVTDNNTGNKYMLADYEMTPNMAIVDAELMMKMPKGLTAYSGIDALVNSIEAY CCCCCEEEEEECCCCCEEEEEECEECCCEEEEEHHHHHHCCCCCCHHHHHHHHHHHHHHH TSVYASEYTNGLALEAIRLIFKYLPEAYKNGRTNEKAREKMAHASTMAGMASANAFLGLC HHHHHHHHCCCHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHH HSMAIKLSSEHNIPSGIANALLIEEVIKFNAVDNPVKQAPCPQYKYPNTIFRYARIADYI HHHHHEECCCCCCCHHHHHHHHHHHHHHHCCCCCCHHCCCCCCCCCCHHHHHHHHHHHHH KLGGNTDEEKVDLLINKIHELKKALNIPTSIKDAGVLEENFYSSLDRISELALDDQCTGA HCCCCCCHHHHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHHCCCCCCCC NPRFPLTSEIKEMYINCFKKQP CCCCCCHHHHHHHHHHHHCCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 8226639; 8300540; 11466286