| Definition | Cupriavidus metallidurans CH34 megaplasmid, complete sequence. |
|---|---|
| Accession | NC_007974 |
| Length | 2,580,084 |
Click here to switch to the map view.
The map label for this gene is catF [H]
Identifier: 94312601
GI number: 94312601
Start: 206336
End: 207538
Strand: Direct
Name: catF [H]
Synonym: Rmet_3669
Alternate gene names: 94312601
Gene position: 206336-207538 (Clockwise)
Preceding gene: 94312600
Following gene: 94312602
Centisome position: 8.0
GC content: 67.83
Gene sequence:
>1203_bases ATGAGCGAAGCATTCATCGTTGACGCCATCCGTACCCCCATCGGCCGTTACGCCGGCAGCCTGTCCGGCGTGCGCGCGGA CGACCTGGGCGCCGTGCCCCTGAAGGCCCTGATGGCCCGTAACGCCAGCGTGGACTGGTCGGCGATCGACGACGTGATCT TTGGCAACGCCAACCAGGCCGGTGAAGACAACCGCAACGTTGCGCGCATGTCGGCCCTGCTGGCTGGCCTGCCGGACGCC GTTCCCGGCGCGACGATCAACCGCCTGTGCGGTTCGGGCATGGACGCCACCGGCACCGCCGCCCGCGCCATCAAGGCTGG TGAAGCCAACCTGATGATTTCCGGCGGCGTGGAAAGCATGAGCCGCGCCCCGTTCGTCATGGGCAAGGCCACCTCGGCCT TCTCGCGTGACGCGCAGATCTTCGACACGACCATCGGCTGGCGTTTCATCAACCCGGCGATGCGCGCCGCCTACGGCGTG GACTCGATGCCCGAGACCGCCGAGAACGTGGCGACCGACTACAAGATCGGCCGTGAAGACCAGGATCTGATGGCGCTGCG CAGCCAGGAGAAGGCATCGCGCGCGCAAGCCGACGGCACGCTGGCGCAGGAAATCACCCCGGTGACGATTCCGCAGAAGA AGGGCGACGCCATCGTGGTCGACCGCGACGAACATCCGCGTGCCACGAGCATGGAAGCGCTGGCCAAGCTGCGCGGCGTG GTGCGTCCGGACGGCACGGTGACCGCCGGTAACGCCTCGGGCGTGAACGATGGCGCGTGCGCGCTGCTGCTGGCCAGCGA AGCGGGCCTGAAGCAGCACGGCCTGAAGCCGCGTGCCCGCATCGTTGGCATGGCAACGGCTGGTGTGGCACCGCGCGTGA TGGGTATCGGCCCGGCGCCGGCCACGCAGAAGCTGATGAAGCAACTGGGCATGACGCTGGACCAGATCGACGTGATCGAA CTGAACGAAGCGTTCGCCGCGCAAGGCCTGGCCGTACTGCGTCAACTGGGCATCGCCGACGACGACAAGCGTGTGAACCC GAACGGCGGCGCCATCGCACTGGGCCACCCGCTCGGCATGAGCGGCGCGCGTCTGGTGACGACCGCGATGTACCAGCTGG AGCGCACTGGTGGCCGCTTCGCGCTGTGCACGATGTGCATCGGCGTGGGCCAGGGCATCGCCATGGTGATCGAGCGCGTT TGA
Upstream 100 bases:
>100_bases GTGGACGGCCTGTCGTTCGACGAACTGCAACGCCTGACCGGCGTGCCTCTCAAGCAGGCCGTAGCCGCCTGACCAACCAC CAAGACGAGCGAGACAGAAC
Downstream 100 bases:
>100_bases TGGCTTGATGCATGGCTACCGGCCGATGCCAGTGGTCATGCGCTCCTCTCTCCCGCGCAGGTGGGAGAGAGGAGTTACCG AAGCAAAACAGTAGAAGTTT
Product: beta-ketoadipyl CoA thiolase
Products: NA
Alternate protein names: 3-oxoadipyl-CoA thiolase [H]
Number of amino acids: Translated: 400; Mature: 399
Protein sequence:
>400_residues MSEAFIVDAIRTPIGRYAGSLSGVRADDLGAVPLKALMARNASVDWSAIDDVIFGNANQAGEDNRNVARMSALLAGLPDA VPGATINRLCGSGMDATGTAARAIKAGEANLMISGGVESMSRAPFVMGKATSAFSRDAQIFDTTIGWRFINPAMRAAYGV DSMPETAENVATDYKIGREDQDLMALRSQEKASRAQADGTLAQEITPVTIPQKKGDAIVVDRDEHPRATSMEALAKLRGV VRPDGTVTAGNASGVNDGACALLLASEAGLKQHGLKPRARIVGMATAGVAPRVMGIGPAPATQKLMKQLGMTLDQIDVIE LNEAFAAQGLAVLRQLGIADDDKRVNPNGGAIALGHPLGMSGARLVTTAMYQLERTGGRFALCTMCIGVGQGIAMVIERV
Sequences:
>Translated_400_residues MSEAFIVDAIRTPIGRYAGSLSGVRADDLGAVPLKALMARNASVDWSAIDDVIFGNANQAGEDNRNVARMSALLAGLPDA VPGATINRLCGSGMDATGTAARAIKAGEANLMISGGVESMSRAPFVMGKATSAFSRDAQIFDTTIGWRFINPAMRAAYGV DSMPETAENVATDYKIGREDQDLMALRSQEKASRAQADGTLAQEITPVTIPQKKGDAIVVDRDEHPRATSMEALAKLRGV VRPDGTVTAGNASGVNDGACALLLASEAGLKQHGLKPRARIVGMATAGVAPRVMGIGPAPATQKLMKQLGMTLDQIDVIE LNEAFAAQGLAVLRQLGIADDDKRVNPNGGAIALGHPLGMSGARLVTTAMYQLERTGGRFALCTMCIGVGQGIAMVIERV >Mature_399_residues SEAFIVDAIRTPIGRYAGSLSGVRADDLGAVPLKALMARNASVDWSAIDDVIFGNANQAGEDNRNVARMSALLAGLPDAV PGATINRLCGSGMDATGTAARAIKAGEANLMISGGVESMSRAPFVMGKATSAFSRDAQIFDTTIGWRFINPAMRAAYGVD SMPETAENVATDYKIGREDQDLMALRSQEKASRAQADGTLAQEITPVTIPQKKGDAIVVDRDEHPRATSMEALAKLRGVV RPDGTVTAGNASGVNDGACALLLASEAGLKQHGLKPRARIVGMATAGVAPRVMGIGPAPATQKLMKQLGMTLDQIDVIEL NEAFAAQGLAVLRQLGIADDDKRVNPNGGAIALGHPLGMSGARLVTTAMYQLERTGGRFALCTMCIGVGQGIAMVIERV
Specific function: Catalyzes thiolytic cleavage of beta-ketoadipyl-CoA to succinyl-CoA and acetyl-CoA [H]
COG id: COG0183
COG function: function code I; Acetyl-CoA acetyltransferase
Gene ontology:
Cell location: Cytoplasmic
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the thiolase family [H]
Homologues:
Organism=Homo sapiens, GI167614485, Length=397, Percent_Identity=42.0654911838791, Blast_Score=286, Evalue=3e-77, Organism=Homo sapiens, GI148539872, Length=398, Percent_Identity=39.6984924623116, Blast_Score=270, Evalue=2e-72, Organism=Homo sapiens, GI4557237, Length=401, Percent_Identity=35.6608478802993, Blast_Score=231, Evalue=1e-60, Organism=Homo sapiens, GI4501853, Length=408, Percent_Identity=37.5, Blast_Score=223, Evalue=3e-58, Organism=Homo sapiens, GI4504327, Length=427, Percent_Identity=32.0843091334895, Blast_Score=194, Evalue=1e-49, Organism=Homo sapiens, GI194353979, Length=404, Percent_Identity=28.960396039604, Blast_Score=137, Evalue=2e-32, Organism=Escherichia coli, GI1787663, Length=401, Percent_Identity=66.0847880299252, Blast_Score=540, Evalue=1e-155, Organism=Escherichia coli, GI1788554, Length=403, Percent_Identity=47.394540942928, Blast_Score=303, Evalue=1e-83, Organism=Escherichia coli, GI87082165, Length=401, Percent_Identity=44.139650872818, Blast_Score=293, Evalue=1e-80, Organism=Escherichia coli, GI48994986, Length=405, Percent_Identity=43.4567901234568, Blast_Score=288, Evalue=4e-79, Organism=Escherichia coli, GI1788683, Length=424, Percent_Identity=32.311320754717, Blast_Score=174, Evalue=1e-44, Organism=Caenorhabditis elegans, GI133906874, Length=401, Percent_Identity=43.8902743142145, Blast_Score=317, Evalue=1e-86, Organism=Caenorhabditis elegans, GI25147385, Length=398, Percent_Identity=36.4321608040201, Blast_Score=241, Evalue=4e-64, Organism=Caenorhabditis elegans, GI17535921, Length=406, Percent_Identity=34.9753694581281, Blast_Score=208, Evalue=4e-54, Organism=Caenorhabditis elegans, GI17551802, Length=432, Percent_Identity=31.0185185185185, Blast_Score=181, Evalue=6e-46, Organism=Caenorhabditis elegans, GI17535917, Length=406, Percent_Identity=30.7881773399015, Blast_Score=167, Evalue=1e-41, Organism=Saccharomyces cerevisiae, GI6325229, Length=400, Percent_Identity=39, Blast_Score=243, Evalue=5e-65, Organism=Saccharomyces cerevisiae, GI6322031, Length=412, Percent_Identity=34.7087378640777, Blast_Score=211, Evalue=2e-55, Organism=Drosophila melanogaster, GI24655093, Length=401, Percent_Identity=44.8877805486284, Blast_Score=322, Evalue=2e-88, Organism=Drosophila melanogaster, GI17648125, Length=403, Percent_Identity=40.9429280397022, Blast_Score=270, Evalue=1e-72, Organism=Drosophila melanogaster, GI24640423, Length=405, Percent_Identity=34.8148148148148, Blast_Score=226, Evalue=3e-59, Organism=Drosophila melanogaster, GI17137578, Length=424, Percent_Identity=32.311320754717, Blast_Score=185, Evalue=6e-47, Organism=Drosophila melanogaster, GI19921506, Length=320, Percent_Identity=24.375, Blast_Score=73, Evalue=4e-13, Organism=Drosophila melanogaster, GI24585051, Length=320, Percent_Identity=25, Blast_Score=72, Evalue=8e-13,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR012793 - InterPro: IPR002155 - InterPro: IPR016039 - InterPro: IPR016038 - InterPro: IPR020615 - InterPro: IPR020610 - InterPro: IPR020617 - InterPro: IPR020613 - InterPro: IPR020616 [H]
Pfam domain/function: PF02803 Thiolase_C; PF00108 Thiolase_N [H]
EC number: =2.3.1.174 [H]
Molecular weight: Translated: 41672; Mature: 41541
Theoretical pI: Translated: 6.78; Mature: 6.78
Prosite motif: PS00737 THIOLASE_2 ; PS00099 THIOLASE_3
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.0 %Cys (Translated Protein) 4.8 %Met (Translated Protein) 5.8 %Cys+Met (Translated Protein) 1.0 %Cys (Mature Protein) 4.5 %Met (Mature Protein) 5.5 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MSEAFIVDAIRTPIGRYAGSLSGVRADDLGAVPLKALMARNASVDWSAIDDVIFGNANQA CCCCEEHHHHHCCHHHHHCCCCCCCCCCCCCHHHHHHHHCCCCCCHHHHHHHHCCCCCCC GEDNRNVARMSALLAGLPDAVPGATINRLCGSGMDATGTAARAIKAGEANLMISGGVESM CCCCCHHHHHHHHHHCCCCCCCCHHHHHHHCCCCCCCCHHHHHHCCCCCCEEEECCHHHH SRAPFVMGKATSAFSRDAQIFDTTIGWRFINPAMRAAYGVDSMPETAENVATDYKIGRED HCCCEEEECCHHHHCCCCHHEEHHCCCEECCHHHHHHHCCCCCCHHHHHHHHHCCCCCCC QDLMALRSQEKASRAQADGTLAQEITPVTIPQKKGDAIVVDRDEHPRATSMEALAKLRGV HHHHHHHHHHHHHHHHCCCCHHHHCCCEECCCCCCCEEEEECCCCCCHHHHHHHHHHHCC VRPDGTVTAGNASGVNDGACALLLASEAGLKQHGLKPRARIVGMATAGVAPRVMGIGPAP CCCCCCEECCCCCCCCCCCEEEEEECCCCHHHHCCCCHHHEEEEECCCCCCCEEECCCCH ATQKLMKQLGMTLDQIDVIELNEAFAAQGLAVLRQLGIADDDKRVNPNGGAIALGHPLGM HHHHHHHHHCCCHHCEEEEECCHHHHHHHHHHHHHHCCCCCCCEECCCCCEEEECCCCCC SGARLVTTAMYQLERTGGRFALCTMCIGVGQGIAMVIERV CCHHHHHHHHHHHHHCCCCHHHHHHHHHHCCCHHHHHHCC >Mature Secondary Structure SEAFIVDAIRTPIGRYAGSLSGVRADDLGAVPLKALMARNASVDWSAIDDVIFGNANQA CCCEEHHHHHCCHHHHHCCCCCCCCCCCCCHHHHHHHHCCCCCCHHHHHHHHCCCCCCC GEDNRNVARMSALLAGLPDAVPGATINRLCGSGMDATGTAARAIKAGEANLMISGGVESM CCCCCHHHHHHHHHHCCCCCCCCHHHHHHHCCCCCCCCHHHHHHCCCCCCEEEECCHHHH SRAPFVMGKATSAFSRDAQIFDTTIGWRFINPAMRAAYGVDSMPETAENVATDYKIGRED HCCCEEEECCHHHHCCCCHHEEHHCCCEECCHHHHHHHCCCCCCHHHHHHHHHCCCCCCC QDLMALRSQEKASRAQADGTLAQEITPVTIPQKKGDAIVVDRDEHPRATSMEALAKLRGV HHHHHHHHHHHHHHHHCCCCHHHHCCCEECCCCCCCEEEEECCCCCCHHHHHHHHHHHCC VRPDGTVTAGNASGVNDGACALLLASEAGLKQHGLKPRARIVGMATAGVAPRVMGIGPAP CCCCCCEECCCCCCCCCCCEEEEEECCCCHHHHCCCCHHHEEEEECCCCCCCEEECCCCH ATQKLMKQLGMTLDQIDVIELNEAFAAQGLAVLRQLGIADDDKRVNPNGGAIALGHPLGM HHHHHHHHHCCCHHCEEEEECCHHHHHHHHHHHHHHCCCCCCCEECCCCCEEEECCCCCC SGARLVTTAMYQLERTGGRFALCTMCIGVGQGIAMVIERV CCHHHHHHHHHHHHHCCCCHHHHHHHHHHCCCHHHHHHCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 8125318 [H]