Definition Cupriavidus metallidurans CH34 megaplasmid, complete sequence.
Accession NC_007974
Length 2,580,084

Click here to switch to the map view.

The map label for this gene is catF [H]

Identifier: 94312601

GI number: 94312601

Start: 206336

End: 207538

Strand: Direct

Name: catF [H]

Synonym: Rmet_3669

Alternate gene names: 94312601

Gene position: 206336-207538 (Clockwise)

Preceding gene: 94312600

Following gene: 94312602

Centisome position: 8.0

GC content: 67.83

Gene sequence:

>1203_bases
ATGAGCGAAGCATTCATCGTTGACGCCATCCGTACCCCCATCGGCCGTTACGCCGGCAGCCTGTCCGGCGTGCGCGCGGA
CGACCTGGGCGCCGTGCCCCTGAAGGCCCTGATGGCCCGTAACGCCAGCGTGGACTGGTCGGCGATCGACGACGTGATCT
TTGGCAACGCCAACCAGGCCGGTGAAGACAACCGCAACGTTGCGCGCATGTCGGCCCTGCTGGCTGGCCTGCCGGACGCC
GTTCCCGGCGCGACGATCAACCGCCTGTGCGGTTCGGGCATGGACGCCACCGGCACCGCCGCCCGCGCCATCAAGGCTGG
TGAAGCCAACCTGATGATTTCCGGCGGCGTGGAAAGCATGAGCCGCGCCCCGTTCGTCATGGGCAAGGCCACCTCGGCCT
TCTCGCGTGACGCGCAGATCTTCGACACGACCATCGGCTGGCGTTTCATCAACCCGGCGATGCGCGCCGCCTACGGCGTG
GACTCGATGCCCGAGACCGCCGAGAACGTGGCGACCGACTACAAGATCGGCCGTGAAGACCAGGATCTGATGGCGCTGCG
CAGCCAGGAGAAGGCATCGCGCGCGCAAGCCGACGGCACGCTGGCGCAGGAAATCACCCCGGTGACGATTCCGCAGAAGA
AGGGCGACGCCATCGTGGTCGACCGCGACGAACATCCGCGTGCCACGAGCATGGAAGCGCTGGCCAAGCTGCGCGGCGTG
GTGCGTCCGGACGGCACGGTGACCGCCGGTAACGCCTCGGGCGTGAACGATGGCGCGTGCGCGCTGCTGCTGGCCAGCGA
AGCGGGCCTGAAGCAGCACGGCCTGAAGCCGCGTGCCCGCATCGTTGGCATGGCAACGGCTGGTGTGGCACCGCGCGTGA
TGGGTATCGGCCCGGCGCCGGCCACGCAGAAGCTGATGAAGCAACTGGGCATGACGCTGGACCAGATCGACGTGATCGAA
CTGAACGAAGCGTTCGCCGCGCAAGGCCTGGCCGTACTGCGTCAACTGGGCATCGCCGACGACGACAAGCGTGTGAACCC
GAACGGCGGCGCCATCGCACTGGGCCACCCGCTCGGCATGAGCGGCGCGCGTCTGGTGACGACCGCGATGTACCAGCTGG
AGCGCACTGGTGGCCGCTTCGCGCTGTGCACGATGTGCATCGGCGTGGGCCAGGGCATCGCCATGGTGATCGAGCGCGTT
TGA

Upstream 100 bases:

>100_bases
GTGGACGGCCTGTCGTTCGACGAACTGCAACGCCTGACCGGCGTGCCTCTCAAGCAGGCCGTAGCCGCCTGACCAACCAC
CAAGACGAGCGAGACAGAAC

Downstream 100 bases:

>100_bases
TGGCTTGATGCATGGCTACCGGCCGATGCCAGTGGTCATGCGCTCCTCTCTCCCGCGCAGGTGGGAGAGAGGAGTTACCG
AAGCAAAACAGTAGAAGTTT

Product: beta-ketoadipyl CoA thiolase

Products: NA

Alternate protein names: 3-oxoadipyl-CoA thiolase [H]

Number of amino acids: Translated: 400; Mature: 399

Protein sequence:

>400_residues
MSEAFIVDAIRTPIGRYAGSLSGVRADDLGAVPLKALMARNASVDWSAIDDVIFGNANQAGEDNRNVARMSALLAGLPDA
VPGATINRLCGSGMDATGTAARAIKAGEANLMISGGVESMSRAPFVMGKATSAFSRDAQIFDTTIGWRFINPAMRAAYGV
DSMPETAENVATDYKIGREDQDLMALRSQEKASRAQADGTLAQEITPVTIPQKKGDAIVVDRDEHPRATSMEALAKLRGV
VRPDGTVTAGNASGVNDGACALLLASEAGLKQHGLKPRARIVGMATAGVAPRVMGIGPAPATQKLMKQLGMTLDQIDVIE
LNEAFAAQGLAVLRQLGIADDDKRVNPNGGAIALGHPLGMSGARLVTTAMYQLERTGGRFALCTMCIGVGQGIAMVIERV

Sequences:

>Translated_400_residues
MSEAFIVDAIRTPIGRYAGSLSGVRADDLGAVPLKALMARNASVDWSAIDDVIFGNANQAGEDNRNVARMSALLAGLPDA
VPGATINRLCGSGMDATGTAARAIKAGEANLMISGGVESMSRAPFVMGKATSAFSRDAQIFDTTIGWRFINPAMRAAYGV
DSMPETAENVATDYKIGREDQDLMALRSQEKASRAQADGTLAQEITPVTIPQKKGDAIVVDRDEHPRATSMEALAKLRGV
VRPDGTVTAGNASGVNDGACALLLASEAGLKQHGLKPRARIVGMATAGVAPRVMGIGPAPATQKLMKQLGMTLDQIDVIE
LNEAFAAQGLAVLRQLGIADDDKRVNPNGGAIALGHPLGMSGARLVTTAMYQLERTGGRFALCTMCIGVGQGIAMVIERV
>Mature_399_residues
SEAFIVDAIRTPIGRYAGSLSGVRADDLGAVPLKALMARNASVDWSAIDDVIFGNANQAGEDNRNVARMSALLAGLPDAV
PGATINRLCGSGMDATGTAARAIKAGEANLMISGGVESMSRAPFVMGKATSAFSRDAQIFDTTIGWRFINPAMRAAYGVD
SMPETAENVATDYKIGREDQDLMALRSQEKASRAQADGTLAQEITPVTIPQKKGDAIVVDRDEHPRATSMEALAKLRGVV
RPDGTVTAGNASGVNDGACALLLASEAGLKQHGLKPRARIVGMATAGVAPRVMGIGPAPATQKLMKQLGMTLDQIDVIEL
NEAFAAQGLAVLRQLGIADDDKRVNPNGGAIALGHPLGMSGARLVTTAMYQLERTGGRFALCTMCIGVGQGIAMVIERV

Specific function: Catalyzes thiolytic cleavage of beta-ketoadipyl-CoA to succinyl-CoA and acetyl-CoA [H]

COG id: COG0183

COG function: function code I; Acetyl-CoA acetyltransferase

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the thiolase family [H]

Homologues:

Organism=Homo sapiens, GI167614485, Length=397, Percent_Identity=42.0654911838791, Blast_Score=286, Evalue=3e-77,
Organism=Homo sapiens, GI148539872, Length=398, Percent_Identity=39.6984924623116, Blast_Score=270, Evalue=2e-72,
Organism=Homo sapiens, GI4557237, Length=401, Percent_Identity=35.6608478802993, Blast_Score=231, Evalue=1e-60,
Organism=Homo sapiens, GI4501853, Length=408, Percent_Identity=37.5, Blast_Score=223, Evalue=3e-58,
Organism=Homo sapiens, GI4504327, Length=427, Percent_Identity=32.0843091334895, Blast_Score=194, Evalue=1e-49,
Organism=Homo sapiens, GI194353979, Length=404, Percent_Identity=28.960396039604, Blast_Score=137, Evalue=2e-32,
Organism=Escherichia coli, GI1787663, Length=401, Percent_Identity=66.0847880299252, Blast_Score=540, Evalue=1e-155,
Organism=Escherichia coli, GI1788554, Length=403, Percent_Identity=47.394540942928, Blast_Score=303, Evalue=1e-83,
Organism=Escherichia coli, GI87082165, Length=401, Percent_Identity=44.139650872818, Blast_Score=293, Evalue=1e-80,
Organism=Escherichia coli, GI48994986, Length=405, Percent_Identity=43.4567901234568, Blast_Score=288, Evalue=4e-79,
Organism=Escherichia coli, GI1788683, Length=424, Percent_Identity=32.311320754717, Blast_Score=174, Evalue=1e-44,
Organism=Caenorhabditis elegans, GI133906874, Length=401, Percent_Identity=43.8902743142145, Blast_Score=317, Evalue=1e-86,
Organism=Caenorhabditis elegans, GI25147385, Length=398, Percent_Identity=36.4321608040201, Blast_Score=241, Evalue=4e-64,
Organism=Caenorhabditis elegans, GI17535921, Length=406, Percent_Identity=34.9753694581281, Blast_Score=208, Evalue=4e-54,
Organism=Caenorhabditis elegans, GI17551802, Length=432, Percent_Identity=31.0185185185185, Blast_Score=181, Evalue=6e-46,
Organism=Caenorhabditis elegans, GI17535917, Length=406, Percent_Identity=30.7881773399015, Blast_Score=167, Evalue=1e-41,
Organism=Saccharomyces cerevisiae, GI6325229, Length=400, Percent_Identity=39, Blast_Score=243, Evalue=5e-65,
Organism=Saccharomyces cerevisiae, GI6322031, Length=412, Percent_Identity=34.7087378640777, Blast_Score=211, Evalue=2e-55,
Organism=Drosophila melanogaster, GI24655093, Length=401, Percent_Identity=44.8877805486284, Blast_Score=322, Evalue=2e-88,
Organism=Drosophila melanogaster, GI17648125, Length=403, Percent_Identity=40.9429280397022, Blast_Score=270, Evalue=1e-72,
Organism=Drosophila melanogaster, GI24640423, Length=405, Percent_Identity=34.8148148148148, Blast_Score=226, Evalue=3e-59,
Organism=Drosophila melanogaster, GI17137578, Length=424, Percent_Identity=32.311320754717, Blast_Score=185, Evalue=6e-47,
Organism=Drosophila melanogaster, GI19921506, Length=320, Percent_Identity=24.375, Blast_Score=73, Evalue=4e-13,
Organism=Drosophila melanogaster, GI24585051, Length=320, Percent_Identity=25, Blast_Score=72, Evalue=8e-13,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR012793
- InterPro:   IPR002155
- InterPro:   IPR016039
- InterPro:   IPR016038
- InterPro:   IPR020615
- InterPro:   IPR020610
- InterPro:   IPR020617
- InterPro:   IPR020613
- InterPro:   IPR020616 [H]

Pfam domain/function: PF02803 Thiolase_C; PF00108 Thiolase_N [H]

EC number: =2.3.1.174 [H]

Molecular weight: Translated: 41672; Mature: 41541

Theoretical pI: Translated: 6.78; Mature: 6.78

Prosite motif: PS00737 THIOLASE_2 ; PS00099 THIOLASE_3

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.0 %Cys     (Translated Protein)
4.8 %Met     (Translated Protein)
5.8 %Cys+Met (Translated Protein)
1.0 %Cys     (Mature Protein)
4.5 %Met     (Mature Protein)
5.5 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSEAFIVDAIRTPIGRYAGSLSGVRADDLGAVPLKALMARNASVDWSAIDDVIFGNANQA
CCCCEEHHHHHCCHHHHHCCCCCCCCCCCCCHHHHHHHHCCCCCCHHHHHHHHCCCCCCC
GEDNRNVARMSALLAGLPDAVPGATINRLCGSGMDATGTAARAIKAGEANLMISGGVESM
CCCCCHHHHHHHHHHCCCCCCCCHHHHHHHCCCCCCCCHHHHHHCCCCCCEEEECCHHHH
SRAPFVMGKATSAFSRDAQIFDTTIGWRFINPAMRAAYGVDSMPETAENVATDYKIGRED
HCCCEEEECCHHHHCCCCHHEEHHCCCEECCHHHHHHHCCCCCCHHHHHHHHHCCCCCCC
QDLMALRSQEKASRAQADGTLAQEITPVTIPQKKGDAIVVDRDEHPRATSMEALAKLRGV
HHHHHHHHHHHHHHHHCCCCHHHHCCCEECCCCCCCEEEEECCCCCCHHHHHHHHHHHCC
VRPDGTVTAGNASGVNDGACALLLASEAGLKQHGLKPRARIVGMATAGVAPRVMGIGPAP
CCCCCCEECCCCCCCCCCCEEEEEECCCCHHHHCCCCHHHEEEEECCCCCCCEEECCCCH
ATQKLMKQLGMTLDQIDVIELNEAFAAQGLAVLRQLGIADDDKRVNPNGGAIALGHPLGM
HHHHHHHHHCCCHHCEEEEECCHHHHHHHHHHHHHHCCCCCCCEECCCCCEEEECCCCCC
SGARLVTTAMYQLERTGGRFALCTMCIGVGQGIAMVIERV
CCHHHHHHHHHHHHHCCCCHHHHHHHHHHCCCHHHHHHCC
>Mature Secondary Structure 
SEAFIVDAIRTPIGRYAGSLSGVRADDLGAVPLKALMARNASVDWSAIDDVIFGNANQA
CCCEEHHHHHCCHHHHHCCCCCCCCCCCCCHHHHHHHHCCCCCCHHHHHHHHCCCCCCC
GEDNRNVARMSALLAGLPDAVPGATINRLCGSGMDATGTAARAIKAGEANLMISGGVESM
CCCCCHHHHHHHHHHCCCCCCCCHHHHHHHCCCCCCCCHHHHHHCCCCCCEEEECCHHHH
SRAPFVMGKATSAFSRDAQIFDTTIGWRFINPAMRAAYGVDSMPETAENVATDYKIGRED
HCCCEEEECCHHHHCCCCHHEEHHCCCEECCHHHHHHHCCCCCCHHHHHHHHHCCCCCCC
QDLMALRSQEKASRAQADGTLAQEITPVTIPQKKGDAIVVDRDEHPRATSMEALAKLRGV
HHHHHHHHHHHHHHHHCCCCHHHHCCCEECCCCCCCEEEEECCCCCCHHHHHHHHHHHCC
VRPDGTVTAGNASGVNDGACALLLASEAGLKQHGLKPRARIVGMATAGVAPRVMGIGPAP
CCCCCCEECCCCCCCCCCCEEEEEECCCCHHHHCCCCHHHEEEEECCCCCCCEEECCCCH
ATQKLMKQLGMTLDQIDVIELNEAFAAQGLAVLRQLGIADDDKRVNPNGGAIALGHPLGM
HHHHHHHHHCCCHHCEEEEECCHHHHHHHHHHHHHHCCCCCCCEECCCCCEEEECCCCCC
SGARLVTTAMYQLERTGGRFALCTMCIGVGQGIAMVIERV
CCHHHHHHHHHHHHHCCCCHHHHHHHHHHCCCHHHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 8125318 [H]