| Definition | Novosphingobium aromaticivorans DSM 12444 chromosome, complete genome. |
|---|---|
| Accession | NC_007794 |
| Length | 3,561,584 |
Click here to switch to the map view.
The map label for this gene is phbA [H]
Identifier: 87199244
GI number: 87199244
Start: 1274354
End: 1275568
Strand: Reverse
Name: phbA [H]
Synonym: Saro_1222
Alternate gene names: 87199244
Gene position: 1275568-1274354 (Counterclockwise)
Preceding gene: 87199245
Following gene: 87199243
Centisome position: 35.81
GC content: 67.57
Gene sequence:
>1215_bases ATGACCCAGCTTCGCCACGCCGCCATCGTCGCCCCCATCCGCACCGCCGTGGGCAAGTTCGGCGGCTCGCTGTCGCCTCT CACCGCCGGGCAACTGGGCGCAACGATCCTCACGGCGCTGATGGACCGCACAAGGATCGACCCCGCGCGCGTCGATGACG TGATCTTCGCGCAGGGTTACGGCAACGGCGAGGCGCCGTGCATCTCGCACTGGTCGTGGCTGCTCGCGGGCCTGCCCGAG GAAGTTCCCGGCTACCAGCTCGATCGCCGCTGCGGCTCGGGCCTCCAGTCGATCGTCAATGCGGCGATGATGGTGCAGAC CGGGGTTTCCGACGTCGTCGTGGCGGGCGGCGTGGAATCGATGTCCAACGTCGAGCACTATACCACTGACGTCCGCAAGG GCGTGCGCGCGGGCTCGCTGACCCTTCACGACCGCCTTACCCGTGGCCGCGTGATGAGCCAGCCGATCGAGCGCTATGGC GTGATCAGCGGCATGATCGAGACGGCGGAAAACCTCGCCAAGGACTTTGCCATCACCCGCGAAGCCTGCGACGCCTATGC CGTGCGCAGCCACCAGCGCGCGGCTGCTGCATGGGCCAACGGCCTGTTCGACGACGAACTCGTTCCGGTCTCCATCCCCC AGAAAAAGGGCGACCCCGTTCTCTTCGCCCACGACGAGGGTTACCGTGCCGACGCCAGCATGGAAACGCTTGGCAAGCTG CGCCCCCTCGAAGGCGGCGTCGTGACGGCAGGCAACGCCAGCCAGCAGAACGACGCGGCCGCCGCCTGCCTCGTCGTCGC GGAAGACAAGCTCGCCGAACTCGGCCTCGAACCCATCGCGTGGTTCCATTCCTGGGCGGCAGCGGGCTGCGATCCGAGCC GCATGGGCTATGGCCCTGTCCCCGCTACCGAGCGCCTGTTCGCCCGCAACGGCCTGACGTGGAACGACATCGACCTCATC GAACTGAACGAGGCCTTCGCCCCTCAGGTTCTCGCCTGCCTCAAGGGCTGGGGCTGGTCGGACGACGACAGCCGCCACGA GATGCTGAACGTCAATGGCTCGGGCATCAGCCTCGGCCATCCCATCGGCGCCACCGGCGGGCGCATCCTCGCCAACCTTA CGCGCGAATTGAAGCGGCGCGGCGGGCGCTATGGCCTTGAAACCATGTGCATTGGTGGCGGTCAGGGAATCGCGGCGGTG TTCGAGGCGGCCTGA
Upstream 100 bases:
>100_bases CACGCTGATCGACCGGGGCGTGGTGGCACGATCCGACAAAGACCAATGATCAATCCCCCTCCCGTTCCCGTAGAGCGGAT GTCGTGAAGGATTTACCGTG
Downstream 100 bases:
>100_bases TGATCCTCTCGCCGTACGACAGCGAAGACCACGGCGAAATCCGTGAGGGCGTTCGCAAGCTATGCGCCCAGTTTCCGGGC GAGTACTGGCGCAAGCTCGA
Product: acetyl-CoA acetyltransferase
Products: NA
Alternate protein names: Acetoacetyl-CoA thiolase [H]
Number of amino acids: Translated: 404; Mature: 403
Protein sequence:
>404_residues MTQLRHAAIVAPIRTAVGKFGGSLSPLTAGQLGATILTALMDRTRIDPARVDDVIFAQGYGNGEAPCISHWSWLLAGLPE EVPGYQLDRRCGSGLQSIVNAAMMVQTGVSDVVVAGGVESMSNVEHYTTDVRKGVRAGSLTLHDRLTRGRVMSQPIERYG VISGMIETAENLAKDFAITREACDAYAVRSHQRAAAAWANGLFDDELVPVSIPQKKGDPVLFAHDEGYRADASMETLGKL RPLEGGVVTAGNASQQNDAAAACLVVAEDKLAELGLEPIAWFHSWAAAGCDPSRMGYGPVPATERLFARNGLTWNDIDLI ELNEAFAPQVLACLKGWGWSDDDSRHEMLNVNGSGISLGHPIGATGGRILANLTRELKRRGGRYGLETMCIGGGQGIAAV FEAA
Sequences:
>Translated_404_residues MTQLRHAAIVAPIRTAVGKFGGSLSPLTAGQLGATILTALMDRTRIDPARVDDVIFAQGYGNGEAPCISHWSWLLAGLPE EVPGYQLDRRCGSGLQSIVNAAMMVQTGVSDVVVAGGVESMSNVEHYTTDVRKGVRAGSLTLHDRLTRGRVMSQPIERYG VISGMIETAENLAKDFAITREACDAYAVRSHQRAAAAWANGLFDDELVPVSIPQKKGDPVLFAHDEGYRADASMETLGKL RPLEGGVVTAGNASQQNDAAAACLVVAEDKLAELGLEPIAWFHSWAAAGCDPSRMGYGPVPATERLFARNGLTWNDIDLI ELNEAFAPQVLACLKGWGWSDDDSRHEMLNVNGSGISLGHPIGATGGRILANLTRELKRRGGRYGLETMCIGGGQGIAAV FEAA >Mature_403_residues TQLRHAAIVAPIRTAVGKFGGSLSPLTAGQLGATILTALMDRTRIDPARVDDVIFAQGYGNGEAPCISHWSWLLAGLPEE VPGYQLDRRCGSGLQSIVNAAMMVQTGVSDVVVAGGVESMSNVEHYTTDVRKGVRAGSLTLHDRLTRGRVMSQPIERYGV ISGMIETAENLAKDFAITREACDAYAVRSHQRAAAAWANGLFDDELVPVSIPQKKGDPVLFAHDEGYRADASMETLGKLR PLEGGVVTAGNASQQNDAAAACLVVAEDKLAELGLEPIAWFHSWAAAGCDPSRMGYGPVPATERLFARNGLTWNDIDLIE LNEAFAPQVLACLKGWGWSDDDSRHEMLNVNGSGISLGHPIGATGGRILANLTRELKRRGGRYGLETMCIGGGQGIAAVF EAA
Specific function: SHORT-CHAIN FATTY ACIDS METABOLISM. [C]
COG id: COG0183
COG function: function code I; Acetyl-CoA acetyltransferase
Gene ontology:
Cell location: Cytoplasm [H]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the thiolase family [H]
Homologues:
Organism=Homo sapiens, GI167614485, Length=407, Percent_Identity=39.8034398034398, Blast_Score=271, Evalue=8e-73, Organism=Homo sapiens, GI148539872, Length=401, Percent_Identity=36.6583541147132, Blast_Score=229, Evalue=3e-60, Organism=Homo sapiens, GI4501853, Length=400, Percent_Identity=36, Blast_Score=222, Evalue=4e-58, Organism=Homo sapiens, GI4557237, Length=404, Percent_Identity=35.6435643564356, Blast_Score=211, Evalue=9e-55, Organism=Homo sapiens, GI4504327, Length=428, Percent_Identity=32.4766355140187, Blast_Score=189, Evalue=3e-48, Organism=Homo sapiens, GI194353979, Length=391, Percent_Identity=25.8312020460358, Blast_Score=112, Evalue=6e-25, Organism=Escherichia coli, GI1788554, Length=403, Percent_Identity=43.424317617866, Blast_Score=284, Evalue=9e-78, Organism=Escherichia coli, GI1787663, Length=408, Percent_Identity=42.4019607843137, Blast_Score=276, Evalue=2e-75, Organism=Escherichia coli, GI87082165, Length=402, Percent_Identity=41.5422885572139, Blast_Score=270, Evalue=2e-73, Organism=Escherichia coli, GI48994986, Length=412, Percent_Identity=37.621359223301, Blast_Score=243, Evalue=1e-65, Organism=Escherichia coli, GI1788683, Length=426, Percent_Identity=33.8028169014084, Blast_Score=191, Evalue=8e-50, Organism=Caenorhabditis elegans, GI133906874, Length=398, Percent_Identity=39.4472361809045, Blast_Score=259, Evalue=3e-69, Organism=Caenorhabditis elegans, GI25147385, Length=394, Percent_Identity=32.741116751269, Blast_Score=191, Evalue=4e-49, Organism=Caenorhabditis elegans, GI17535921, Length=401, Percent_Identity=31.4214463840399, Blast_Score=188, Evalue=4e-48, Organism=Caenorhabditis elegans, GI17551802, Length=424, Percent_Identity=29.4811320754717, Blast_Score=168, Evalue=5e-42, Organism=Caenorhabditis elegans, GI17535917, Length=393, Percent_Identity=25.1908396946565, Blast_Score=110, Evalue=2e-24, Organism=Saccharomyces cerevisiae, GI6325229, Length=407, Percent_Identity=33.9066339066339, Blast_Score=196, Evalue=4e-51, Organism=Saccharomyces cerevisiae, GI6322031, Length=402, Percent_Identity=33.5820895522388, Blast_Score=196, Evalue=8e-51, Organism=Drosophila melanogaster, GI24655093, Length=396, Percent_Identity=41.4141414141414, Blast_Score=280, Evalue=1e-75, Organism=Drosophila melanogaster, GI17648125, Length=400, Percent_Identity=39.75, Blast_Score=239, Evalue=2e-63, Organism=Drosophila melanogaster, GI24640423, Length=398, Percent_Identity=35.678391959799, Blast_Score=223, Evalue=2e-58, Organism=Drosophila melanogaster, GI17137578, Length=432, Percent_Identity=29.8611111111111, Blast_Score=171, Evalue=1e-42,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR002155 - InterPro: IPR016039 - InterPro: IPR016038 - InterPro: IPR020615 - InterPro: IPR020610 - InterPro: IPR020617 - InterPro: IPR020613 - InterPro: IPR020616 [H]
Pfam domain/function: PF02803 Thiolase_C; PF00108 Thiolase_N [H]
EC number: =2.3.1.9 [H]
Molecular weight: Translated: 42965; Mature: 42834
Theoretical pI: Translated: 5.43; Mature: 5.43
Prosite motif: PS00178 AA_TRNA_LIGASE_I
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.7 %Cys (Translated Protein) 2.7 %Met (Translated Protein) 4.5 %Cys+Met (Translated Protein) 1.7 %Cys (Mature Protein) 2.5 %Met (Mature Protein) 4.2 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MTQLRHAAIVAPIRTAVGKFGGSLSPLTAGQLGATILTALMDRTRIDPARVDDVIFAQGY CCCHHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHCCCHHHHCCEEEECCC GNGEAPCISHWSWLLAGLPEEVPGYQLDRRCGSGLQSIVNAAMMVQTGVSDVVVAGGVES CCCCCCHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCEEEECCHHH MSNVEHYTTDVRKGVRAGSLTLHDRLTRGRVMSQPIERYGVISGMIETAENLAKDFAITR HHHHHHHHHHHHHCCCCCCEEHHHHHHHCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH EACDAYAVRSHQRAAAAWANGLFDDELVPVSIPQKKGDPVLFAHDEGYRADASMETLGKL HHHHHHHHHHHHHHHHHHHCCCCCCCEEEEECCCCCCCCEEEECCCCCCCCCCHHHHHCC RPLEGGVVTAGNASQQNDAAAACLVVAEDKLAELGLEPIAWFHSWAAAGCDPSRMGYGPV CCCCCCEEECCCCCCCCCHHEEEEEEEHHHHHHCCCHHHHHHHHHHHCCCCHHHCCCCCC PATERLFARNGLTWNDIDLIELNEAFAPQVLACLKGWGWSDDDSRHEMLNVNGSGISLGH CHHHHHHHHCCCCCCCEEEEECCHHHHHHHHHHHHCCCCCCCCCCCCEEECCCCCEECCC PIGATGGRILANLTRELKRRGGRYGLETMCIGGGQGIAAVFEAA CCCCCCHHHHHHHHHHHHHCCCCCCCEEEEEECCCCHHHHEECC >Mature Secondary Structure TQLRHAAIVAPIRTAVGKFGGSLSPLTAGQLGATILTALMDRTRIDPARVDDVIFAQGY CCHHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHCCCHHHHCCEEEECCC GNGEAPCISHWSWLLAGLPEEVPGYQLDRRCGSGLQSIVNAAMMVQTGVSDVVVAGGVES CCCCCCHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCEEEECCHHH MSNVEHYTTDVRKGVRAGSLTLHDRLTRGRVMSQPIERYGVISGMIETAENLAKDFAITR HHHHHHHHHHHHHCCCCCCEEHHHHHHHCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH EACDAYAVRSHQRAAAAWANGLFDDELVPVSIPQKKGDPVLFAHDEGYRADASMETLGKL HHHHHHHHHHHHHHHHHHHCCCCCCCEEEEECCCCCCCCEEEECCCCCCCCCCHHHHHCC RPLEGGVVTAGNASQQNDAAAACLVVAEDKLAELGLEPIAWFHSWAAAGCDPSRMGYGPV CCCCCCEEECCCCCCCCCHHEEEEEEEHHHHHHCCCHHHHHHHHHHHCCCCHHHCCCCCC PATERLFARNGLTWNDIDLIELNEAFAPQVLACLKGWGWSDDDSRHEMLNVNGSGISLGH CHHHHHHHHCCCCCCCEEEEECCHHHHHHHHHHHHCCCCCCCCCCCCEEECCCCCEECCC PIGATGGRILANLTRELKRRGGRYGLETMCIGGGQGIAAVFEAA CCCCCCHHHHHHHHHHHHHCCCCCCCEEEEEECCCCHHHHEECC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 7763384 [H]