Definition Caulobacter crescentus CB15 chromosome, complete genome.
Accession NC_002696
Length 4,016,947

Click here to switch to the map view.

The map label for this gene is aldH [H]

Identifier: 16127023

GI number: 16127023

Start: 3002890

End: 3004476

Strand: Direct

Name: aldH [H]

Synonym: CC_2791

Alternate gene names: 16127023

Gene position: 3002890-3004476 (Clockwise)

Preceding gene: 16127017

Following gene: 16127027

Centisome position: 74.76

GC content: 72.9

Gene sequence:

>1587_bases
ATGGCGCATCTGACGGGCGAGCTTCTGATCGGCGGCGAGCGCCGCTTCGGAATCCACGGCGAGATCAAGGGCGTCAATCC
GGCCACGGGCGAGACCCTGGAGCCGGCGTTCGGCGGCGCGACCACGGCCGATGTCGAGGCCGCGTGCGCCCTGGCGGCCG
AAGCGTTCGGGCCCTACCGGTCCCTGCCCTACGAGACCCGCGCCCAGTTCCTGGAGTCGATCGCCGAGCACATCGAGGCC
ATCGGCGATGATCTGATCGTCCGCACAATGGCCGAGACCGGCCTGCCGCGTCCGCGCCTGGAAGGCGAGCGCGGCCGCAC
GGTGGGCCAGCTGCGCCTGTTCGCCGGCGTGCTGCGCGACGGCGGCTTCCTGGAGGCTCGCATCGACCCGGCCATGCCGG
ACCGCAAGCCCCTGCCGCGTCCGGACCTGCGCCTGCGCAACGTACCGCTGGGCCCTGTGGCCGTGTTCGGGGCATCGAAC
TTCCCGCTGGCCTTCTCGGTGGCCGGCGGCGACACCGCCTCGGCCTTGGCGGCCGGCTGCCCGGTCATCGTCAAGGCCCA
CCCGGCCCACCCCGGCGCCTCGGAGCTGGTCGGCCGCGCCATCCAGGCCGCCGTCGCCGCCTGCGGCCTGCCCCCGGGCG
TGTTCGCGCTGATCCACGACAGCGGCTATGAGGTCAGCCAGGCCCTGGTCGCCGATCCGCGCGTCAAGGCCGCCGGCTTC
ACCGGCTCGCGCCGCGGGGGCCTGGCTTTGCTGGCCATCGCCCAGGGCCGCCCCGAGCCGATTCCGTTCTATGCCGAGAT
GAGCAGCATCAACCCGGTGATCCTGCTGCCGGCCGCCCTGAAGGCGCGGGCCGACAAGATCGCCCCGGACTTCGTGGCCG
CCCTGACGCTCGGGGCCGGCCAGTTCTGCACCAATCCCGGCCTGATCCTGGCGATCGACGGTCCGGAGCTGGACGCCTTC
ATCGAAGCCGCCGGCAAGGCCGTCGAGGCCGCCCCGGCCTCGGTCATGCTGACGCCGGGCATCTGCCAGGCCTTCGCCCA
TGGGGTGGCGGCGCTGACCGACGCCGCCGAGGTCACCACCGTGGCGCGCGGCGTCCCCGGTCCCGACGGCAGCCACACCG
GCCGCGCGGCCCTGTTCAGCGTCACGGCCGCCGACTTCCTGGCCAACCCGCACCTGCATGAGGAAGTGTTCGGCGCGGCC
TCGCTGGTGGTGCGCTGCGCGGGTCAGGCCGAGCTTGAAGCCGTCATCGCCGCGCTCGAGGGCCAGCTGACCATCGCCCT
CCACATGGACGAAGCCGACCATGGGATCGCCGGCGCCCTGCTGCCCGCGCTGGAGCTGAAGGCCGGCCGCATCCTGGTCA
ACGGTTTCGGCACCGGCGTCGAGGTGGCCCCCGCCATGGTCCACGGCGGCCCGTTCCCCTCGACCAGCGACGGCCGCACG
ACTTCGGTCGGCACGCTGGCCATTGCAAGGTTCCTGCGTCCGGTCAGCTACCAGAACCTGCCCGAAGCGCTGCTGCCGGC
GGAGCTGAAGACGCAGAACCCGCTGGGCGTGGTGCGGCGGGTCGATGGGGTGATGAAGCTGGGGTAG

Upstream 100 bases:

>100_bases
GCCGGGGGCGCCCGATTGGCTATCCTGGTCTCAGCGCGCATGGACATGTCATGTTAGCGCTCCCATATAGCGGCTCCACA
CCATAACCAGCAGGACGACC

Downstream 100 bases:

>100_bases
TCAAACACAAGAACCGCTCTCCTCCCCCACCGGGGGAGGGGGACCGGCGAACGCCGGTGGAGGGGCCAGCCGAACGGCAT
AGCCCCTCCGGCGATTTCAG

Product: fatty aldehyde dehydrogenase

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 528; Mature: 527

Protein sequence:

>528_residues
MAHLTGELLIGGERRFGIHGEIKGVNPATGETLEPAFGGATTADVEAACALAAEAFGPYRSLPYETRAQFLESIAEHIEA
IGDDLIVRTMAETGLPRPRLEGERGRTVGQLRLFAGVLRDGGFLEARIDPAMPDRKPLPRPDLRLRNVPLGPVAVFGASN
FPLAFSVAGGDTASALAAGCPVIVKAHPAHPGASELVGRAIQAAVAACGLPPGVFALIHDSGYEVSQALVADPRVKAAGF
TGSRRGGLALLAIAQGRPEPIPFYAEMSSINPVILLPAALKARADKIAPDFVAALTLGAGQFCTNPGLILAIDGPELDAF
IEAAGKAVEAAPASVMLTPGICQAFAHGVAALTDAAEVTTVARGVPGPDGSHTGRAALFSVTAADFLANPHLHEEVFGAA
SLVVRCAGQAELEAVIAALEGQLTIALHMDEADHGIAGALLPALELKAGRILVNGFGTGVEVAPAMVHGGPFPSTSDGRT
TSVGTLAIARFLRPVSYQNLPEALLPAELKTQNPLGVVRRVDGVMKLG

Sequences:

>Translated_528_residues
MAHLTGELLIGGERRFGIHGEIKGVNPATGETLEPAFGGATTADVEAACALAAEAFGPYRSLPYETRAQFLESIAEHIEA
IGDDLIVRTMAETGLPRPRLEGERGRTVGQLRLFAGVLRDGGFLEARIDPAMPDRKPLPRPDLRLRNVPLGPVAVFGASN
FPLAFSVAGGDTASALAAGCPVIVKAHPAHPGASELVGRAIQAAVAACGLPPGVFALIHDSGYEVSQALVADPRVKAAGF
TGSRRGGLALLAIAQGRPEPIPFYAEMSSINPVILLPAALKARADKIAPDFVAALTLGAGQFCTNPGLILAIDGPELDAF
IEAAGKAVEAAPASVMLTPGICQAFAHGVAALTDAAEVTTVARGVPGPDGSHTGRAALFSVTAADFLANPHLHEEVFGAA
SLVVRCAGQAELEAVIAALEGQLTIALHMDEADHGIAGALLPALELKAGRILVNGFGTGVEVAPAMVHGGPFPSTSDGRT
TSVGTLAIARFLRPVSYQNLPEALLPAELKTQNPLGVVRRVDGVMKLG
>Mature_527_residues
AHLTGELLIGGERRFGIHGEIKGVNPATGETLEPAFGGATTADVEAACALAAEAFGPYRSLPYETRAQFLESIAEHIEAI
GDDLIVRTMAETGLPRPRLEGERGRTVGQLRLFAGVLRDGGFLEARIDPAMPDRKPLPRPDLRLRNVPLGPVAVFGASNF
PLAFSVAGGDTASALAAGCPVIVKAHPAHPGASELVGRAIQAAVAACGLPPGVFALIHDSGYEVSQALVADPRVKAAGFT
GSRRGGLALLAIAQGRPEPIPFYAEMSSINPVILLPAALKARADKIAPDFVAALTLGAGQFCTNPGLILAIDGPELDAFI
EAAGKAVEAAPASVMLTPGICQAFAHGVAALTDAAEVTTVARGVPGPDGSHTGRAALFSVTAADFLANPHLHEEVFGAAS
LVVRCAGQAELEAVIAALEGQLTIALHMDEADHGIAGALLPALELKAGRILVNGFGTGVEVAPAMVHGGPFPSTSDGRTT
SVGTLAIARFLRPVSYQNLPEALLPAELKTQNPLGVVRRVDGVMKLG

Specific function: Catalyzes the oxidation of long-chain aliphatic aldehydes to acids. May be implicated in controlling luminescence as it catalyzes the oxidation of the fatty aldehyde substrate for the light-emitting reaction [H]

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the aldehyde dehydrogenase family [H]

Homologues:

Organism=Escherichia coli, GI1788042, Length=366, Percent_Identity=31.1475409836066, Blast_Score=91, Evalue=1e-19,
Organism=Escherichia coli, GI87081896, Length=464, Percent_Identity=26.7241379310345, Blast_Score=79, Evalue=9e-16,
Organism=Escherichia coli, GI1787250, Length=286, Percent_Identity=29.7202797202797, Blast_Score=72, Evalue=1e-13,
Organism=Escherichia coli, GI1789015, Length=326, Percent_Identity=29.4478527607362, Blast_Score=65, Evalue=1e-11,
Organism=Escherichia coli, GI1787558, Length=497, Percent_Identity=26.5593561368209, Blast_Score=62, Evalue=9e-11,
Organism=Escherichia coli, GI87081926, Length=223, Percent_Identity=26.457399103139, Blast_Score=62, Evalue=1e-10,
Organism=Caenorhabditis elegans, GI133930964, Length=331, Percent_Identity=27.190332326284, Blast_Score=67, Evalue=3e-11,
Organism=Caenorhabditis elegans, GI115534176, Length=285, Percent_Identity=27.719298245614, Blast_Score=67, Evalue=3e-11,
Organism=Drosophila melanogaster, GI24666674, Length=314, Percent_Identity=27.0700636942675, Blast_Score=65, Evalue=8e-11,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR016161
- InterPro:   IPR016163
- InterPro:   IPR016162
- InterPro:   IPR015590 [H]

Pfam domain/function: PF00171 Aldedh [H]

EC number: =1.2.1.4 [H]

Molecular weight: Translated: 54204; Mature: 54073

Theoretical pI: Translated: 5.59; Mature: 5.59

Prosite motif: PS01125 ROK

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.1 %Cys     (Translated Protein)
1.5 %Met     (Translated Protein)
2.7 %Cys+Met (Translated Protein)
1.1 %Cys     (Mature Protein)
1.3 %Met     (Mature Protein)
2.5 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MAHLTGELLIGGERRFGIHGEIKGVNPATGETLEPAFGGATTADVEAACALAAEAFGPYR
CCCCCCEEEECCCEEECCCEEECCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHCCCHH
SLPYETRAQFLESIAEHIEAIGDDLIVRTMAETGLPRPRLEGERGRTVGQLRLFAGVLRD
CCCHHHHHHHHHHHHHHHHHHCHHHHHHHHHHHCCCCCCCCCCCCCHHHHHHHHHHHHCC
GGFLEARIDPAMPDRKPLPRPDLRLRNVPLGPVAVFGASNFPLAFSVAGGDTASALAAGC
CCEEEEECCCCCCCCCCCCCCCCEECCCCCCCEEEECCCCCCEEEEECCCCHHHHHHCCC
PVIVKAHPAHPGASELVGRAIQAAVAACGLPPGVFALIHDSGYEVSQALVADPRVKAAGF
CEEEEECCCCCCHHHHHHHHHHHHHHHCCCCCCEEEEEECCCCHHHHHHHCCCCEEECCC
TGSRRGGLALLAIAQGRPEPIPFYAEMSSINPVILLPAALKARADKIAPDFVAALTLGAG
CCCCCCCEEEEEEECCCCCCCCCEEHHCCCCCEEEECCHHHHHHHHCCHHHHHHHHHCCC
QFCTNPGLILAIDGPELDAFIEAAGKAVEAAPASVMLTPGICQAFAHGVAALTDAAEVTT
CCCCCCCEEEEECCCCHHHHHHHHCCHHHCCCCEEEECHHHHHHHHHHHHHHHHHHHHHH
VARGVPGPDGSHTGRAALFSVTAADFLANPHLHEEVFGAASLVVRCAGQAELEAVIAALE
HHCCCCCCCCCCCCCEEEEEEHHHHHHCCCCHHHHHHHHHHHHHHHCCCHHHHHHHHHHC
GQLTIALHMDEADHGIAGALLPALELKAGRILVNGFGTGVEVAPAMVHGGPFPSTSDGRT
CCEEEEEEECCCCCCHHHHHHHHHHHCCCEEEEECCCCCCEECHHHEECCCCCCCCCCCC
TSVGTLAIARFLRPVSYQNLPEALLPAELKTQNPLGVVRRVDGVMKLG
CHHHHHHHHHHHHHCCCCCCCHHHCCCHHCCCCCHHHHHHHHHHHCCC
>Mature Secondary Structure 
AHLTGELLIGGERRFGIHGEIKGVNPATGETLEPAFGGATTADVEAACALAAEAFGPYR
CCCCCEEEECCCEEECCCEEECCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHCCCHH
SLPYETRAQFLESIAEHIEAIGDDLIVRTMAETGLPRPRLEGERGRTVGQLRLFAGVLRD
CCCHHHHHHHHHHHHHHHHHHCHHHHHHHHHHHCCCCCCCCCCCCCHHHHHHHHHHHHCC
GGFLEARIDPAMPDRKPLPRPDLRLRNVPLGPVAVFGASNFPLAFSVAGGDTASALAAGC
CCEEEEECCCCCCCCCCCCCCCCEECCCCCCCEEEECCCCCCEEEEECCCCHHHHHHCCC
PVIVKAHPAHPGASELVGRAIQAAVAACGLPPGVFALIHDSGYEVSQALVADPRVKAAGF
CEEEEECCCCCCHHHHHHHHHHHHHHHCCCCCCEEEEEECCCCHHHHHHHCCCCEEECCC
TGSRRGGLALLAIAQGRPEPIPFYAEMSSINPVILLPAALKARADKIAPDFVAALTLGAG
CCCCCCCEEEEEEECCCCCCCCCEEHHCCCCCEEEECCHHHHHHHHCCHHHHHHHHHCCC
QFCTNPGLILAIDGPELDAFIEAAGKAVEAAPASVMLTPGICQAFAHGVAALTDAAEVTT
CCCCCCCEEEEECCCCHHHHHHHHCCHHHCCCCEEEECHHHHHHHHHHHHHHHHHHHHHH
VARGVPGPDGSHTGRAALFSVTAADFLANPHLHEEVFGAASLVVRCAGQAELEAVIAALE
HHCCCCCCCCCCCCCEEEEEEHHHHHHCCCCHHHHHHHHHHHHHHHCCCHHHHHHHHHHC
GQLTIALHMDEADHGIAGALLPALELKAGRILVNGFGTGVEVAPAMVHGGPFPSTSDGRT
CCEEEEEEECCCCCCHHHHHHHHHHHCCCEEEEECCCCCCEECHHHEECCCCCCCCCCCC
TSVGTLAIARFLRPVSYQNLPEALLPAELKTQNPLGVVRRVDGVMKLG
CHHHHHHHHHHHHHCCCCCCCHHHCCCHHCCCCCHHHHHHHHHHHCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 8527447; 10903148 [H]