| Definition | Sinorhizobium medicae WSM419 chromosome, complete genome. |
|---|---|
| Accession | NC_009636 |
| Length | 3,781,904 |
Click here to switch to the map view.
The map label for this gene is phbA [H]
Identifier: 150398311
GI number: 150398311
Start: 3266553
End: 3267734
Strand: Reverse
Name: phbA [H]
Synonym: Smed_3117
Alternate gene names: 150398311
Gene position: 3267734-3266553 (Counterclockwise)
Preceding gene: 150398313
Following gene: 150398310
Centisome position: 86.4
GC content: 65.82
Gene sequence:
>1182_bases ATGAGCAATCCCTCGATCGTCATCGCCAGCGCCGCCCGCACGGCCGTCGGCTCCTTCAATGGCGCCTTCGGCAATACGCC TGCGCACGAATTGGGCGCGGCCGCGGTCAAGGCGGTTCTGGAGCGGGCCGGTGTCGAAGCCGGCGAAGTGGACGAGGTGA TCCTCGGGCAGGTGCTGCCGGCGGGCGAGGGGCAGAATCCGGCGCGCCAGGCGGCGATGAAAGCCGGAGTCCCGCAGGAA AAGACCGCCTGGGGCATGAATCAGCTCTGCGGCTCCGGCCTGCGCGCCGTGGCGCTCGGCATGCAGCAGATCGCAACCGG TGATGCGAAGGTCATCGTCGCCGGCGGCATGGAGTCGATGTCCATGGCGCCGCATTGCGCGCACTTGCGGGGCGGCGTGA AAATGGGCGATTACAAGATGATCGACACGATGATCAAGGACGGCCTGACGGACGCCTTCTATGGATATCACATGGGCACT ACCGCGGAGAACGTCGCGCGGAAATGGCAGCTTACGCGCGAGGAGCAGGACGAATTCGCGCTGGCCTCCCAGAACAAGGC CGAAGCCGCCCAGAAAGCCGGCCGCTTCGCCGACGAGATCGTTCCTTTCGTCGTCAAGACGCGGAAAGGCGACGTCACTG TCGACCAGGACGAATACATACGTCACGGCGCCACGCTGGAATCGATTGCGAAGCTTCGCCCGGCTTTCGACAAGGAAGGC ACCGTCACTGCCGCCAACGCGTCGGGCCTCAATGACGGCGCCGCCGCCGCTCTGCTGATGACCGAGGCCGAGGCCGGCCG GCGCGGCATCCAGCCGCTTGCCCGCATCGTCTCCTGGGCCACGGCGGGCGTCGACCCGCAGATCATGGGCACGGGCCCGA TCCCCGCATCGCGCAAGGCACTTGAAAAAGCCGGCTGGTCGGTCGCCGAAATTGAACTCGTAGAGGCCAACGAGGCCTTC GCGGCCCAGGCATGCGCCGTCAACAAGGATCTCGGTTGGGACCCGTCGATCGTCAACGTCAATGGCGGCGCGATCGCCAT CGGACATCCGATCGGCGCGTCCGGAGCCCGCGTGCTGAACACGCTTCTTTTTGAAATGAAGCGGCGCAACGTCTCGAAGG GCCTTGCGACACTCTGCATCGGCGGCGGCATGGGGGTCGCCATGTGCGTGGAACGCCTTTAG
Upstream 100 bases:
>100_bases CCTCCTGAAGCTTTTGCGGCAGTGCAACTCGCCGTTTGACTTGCGCCCCTCCCTTTGCCAGTCTGCCTCCATCAGGCAAA GCAAATATGAGGAACGTCCC
Downstream 100 bases:
>100_bases CCGACGCCCGGTGAGCCGGGCGACTTCCAGATCCGGATATGCACAGGCGGCCCGGGCTCCGGGCCGCGGAAGGACGATTT TCGCCAATTTGGCTTAACAG
Product: acetyl-CoA acetyltransferase
Products: NA
Alternate protein names: Acetoacetyl-CoA thiolase [H]
Number of amino acids: Translated: 393; Mature: 392
Protein sequence:
>393_residues MSNPSIVIASAARTAVGSFNGAFGNTPAHELGAAAVKAVLERAGVEAGEVDEVILGQVLPAGEGQNPARQAAMKAGVPQE KTAWGMNQLCGSGLRAVALGMQQIATGDAKVIVAGGMESMSMAPHCAHLRGGVKMGDYKMIDTMIKDGLTDAFYGYHMGT TAENVARKWQLTREEQDEFALASQNKAEAAQKAGRFADEIVPFVVKTRKGDVTVDQDEYIRHGATLESIAKLRPAFDKEG TVTAANASGLNDGAAAALLMTEAEAGRRGIQPLARIVSWATAGVDPQIMGTGPIPASRKALEKAGWSVAEIELVEANEAF AAQACAVNKDLGWDPSIVNVNGGAIAIGHPIGASGARVLNTLLFEMKRRNVSKGLATLCIGGGMGVAMCVERL
Sequences:
>Translated_393_residues MSNPSIVIASAARTAVGSFNGAFGNTPAHELGAAAVKAVLERAGVEAGEVDEVILGQVLPAGEGQNPARQAAMKAGVPQE KTAWGMNQLCGSGLRAVALGMQQIATGDAKVIVAGGMESMSMAPHCAHLRGGVKMGDYKMIDTMIKDGLTDAFYGYHMGT TAENVARKWQLTREEQDEFALASQNKAEAAQKAGRFADEIVPFVVKTRKGDVTVDQDEYIRHGATLESIAKLRPAFDKEG TVTAANASGLNDGAAAALLMTEAEAGRRGIQPLARIVSWATAGVDPQIMGTGPIPASRKALEKAGWSVAEIELVEANEAF AAQACAVNKDLGWDPSIVNVNGGAIAIGHPIGASGARVLNTLLFEMKRRNVSKGLATLCIGGGMGVAMCVERL >Mature_392_residues SNPSIVIASAARTAVGSFNGAFGNTPAHELGAAAVKAVLERAGVEAGEVDEVILGQVLPAGEGQNPARQAAMKAGVPQEK TAWGMNQLCGSGLRAVALGMQQIATGDAKVIVAGGMESMSMAPHCAHLRGGVKMGDYKMIDTMIKDGLTDAFYGYHMGTT AENVARKWQLTREEQDEFALASQNKAEAAQKAGRFADEIVPFVVKTRKGDVTVDQDEYIRHGATLESIAKLRPAFDKEGT VTAANASGLNDGAAAALLMTEAEAGRRGIQPLARIVSWATAGVDPQIMGTGPIPASRKALEKAGWSVAEIELVEANEAFA AQACAVNKDLGWDPSIVNVNGGAIAIGHPIGASGARVLNTLLFEMKRRNVSKGLATLCIGGGMGVAMCVERL
Specific function: SHORT-CHAIN FATTY ACIDS METABOLISM. [C]
COG id: COG0183
COG function: function code I; Acetyl-CoA acetyltransferase
Gene ontology:
Cell location: Cytoplasm [H]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the thiolase family [H]
Homologues:
Organism=Homo sapiens, GI148539872, Length=393, Percent_Identity=57.2519083969466, Blast_Score=471, Evalue=1e-133, Organism=Homo sapiens, GI167614485, Length=389, Percent_Identity=43.9588688946015, Blast_Score=318, Evalue=4e-87, Organism=Homo sapiens, GI4557237, Length=398, Percent_Identity=42.964824120603, Blast_Score=310, Evalue=1e-84, Organism=Homo sapiens, GI4501853, Length=393, Percent_Identity=40.4580152671756, Blast_Score=244, Evalue=9e-65, Organism=Homo sapiens, GI4504327, Length=423, Percent_Identity=33.3333333333333, Blast_Score=184, Evalue=2e-46, Organism=Homo sapiens, GI194353979, Length=389, Percent_Identity=29.8200514138817, Blast_Score=140, Evalue=2e-33, Organism=Escherichia coli, GI1788554, Length=389, Percent_Identity=57.0694087403599, Blast_Score=425, Evalue=1e-120, Organism=Escherichia coli, GI87082165, Length=388, Percent_Identity=54.1237113402062, Blast_Score=422, Evalue=1e-119, Organism=Escherichia coli, GI1787663, Length=396, Percent_Identity=43.9393939393939, Blast_Score=304, Evalue=8e-84, Organism=Escherichia coli, GI48994986, Length=396, Percent_Identity=43.1818181818182, Blast_Score=263, Evalue=2e-71, Organism=Escherichia coli, GI1788683, Length=422, Percent_Identity=33.6492890995261, Blast_Score=192, Evalue=4e-50, Organism=Caenorhabditis elegans, GI133906874, Length=395, Percent_Identity=43.2911392405063, Blast_Score=323, Evalue=6e-89, Organism=Caenorhabditis elegans, GI25147385, Length=393, Percent_Identity=41.4758269720102, Blast_Score=303, Evalue=9e-83, Organism=Caenorhabditis elegans, GI17535921, Length=396, Percent_Identity=40.9090909090909, Blast_Score=282, Evalue=2e-76, Organism=Caenorhabditis elegans, GI17551802, Length=425, Percent_Identity=33.4117647058824, Blast_Score=188, Evalue=5e-48, Organism=Caenorhabditis elegans, GI17535917, Length=400, Percent_Identity=32.25, Blast_Score=185, Evalue=5e-47, Organism=Saccharomyces cerevisiae, GI6325229, Length=398, Percent_Identity=42.2110552763819, Blast_Score=284, Evalue=1e-77, Organism=Saccharomyces cerevisiae, GI6322031, Length=388, Percent_Identity=37.3711340206186, Blast_Score=214, Evalue=2e-56, Organism=Drosophila melanogaster, GI24655093, Length=388, Percent_Identity=58.5051546391753, Blast_Score=468, Evalue=1e-132, Organism=Drosophila melanogaster, GI24640423, Length=390, Percent_Identity=42.5641025641026, Blast_Score=294, Evalue=9e-80, Organism=Drosophila melanogaster, GI17648125, Length=389, Percent_Identity=41.3881748071979, Blast_Score=291, Evalue=4e-79, Organism=Drosophila melanogaster, GI17137578, Length=425, Percent_Identity=34.1176470588235, Blast_Score=191, Evalue=8e-49,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR002155 - InterPro: IPR016039 - InterPro: IPR016038 - InterPro: IPR020615 - InterPro: IPR020610 - InterPro: IPR020617 - InterPro: IPR020613 - InterPro: IPR020616 [H]
Pfam domain/function: PF02803 Thiolase_C; PF00108 Thiolase_N [H]
EC number: =2.3.1.9 [H]
Molecular weight: Translated: 40867; Mature: 40736
Theoretical pI: Translated: 6.27; Mature: 6.27
Prosite motif: PS00098 THIOLASE_1 ; PS00737 THIOLASE_2 ; PS00099 THIOLASE_3
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.3 %Cys (Translated Protein) 4.1 %Met (Translated Protein) 5.3 %Cys+Met (Translated Protein) 1.3 %Cys (Mature Protein) 3.8 %Met (Mature Protein) 5.1 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MSNPSIVIASAARTAVGSFNGAFGNTPAHELGAAAVKAVLERAGVEAGEVDEVILGQVLP CCCCCEEEEECHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHCCC AGEGQNPARQAAMKAGVPQEKTAWGMNQLCGSGLRAVALGMQQIATGDAKVIVAGGMESM CCCCCCHHHHHHHHCCCCCHHHHCCHHHHHHCCHHHHHHHHHHHCCCCCEEEEECCCHHH SMAPHCAHLRGGVKMGDYKMIDTMIKDGLTDAFYGYHMGTTAENVARKWQLTREEQDEFA CCCCHHHHHHCCCCCCCHHHHHHHHHCCCHHHHHHHCCCCCHHHHHHHHHCCHHHHHHHH LASQNKAEAAQKAGRFADEIVPFVVKTRKGDVTVDQDEYIRHGATLESIAKLRPAFDKEG HHCCCHHHHHHHHHHHHHHHHHHHHEECCCCEEECHHHHHHCCCCHHHHHHHCCCCCCCC TVTAANASGLNDGAAAALLMTEAEAGRRGIQPLARIVSWATAGVDPQIMGTGPIPASRKA CEEECCCCCCCCCHHHHHEEHHHHHHHHHHHHHHHHHHHHHCCCCCEEEECCCCCHHHHH LEKAGWSVAEIELVEANEAFAAQACAVNKDLGWDPSIVNVNGGAIAIGHPIGASGARVLN HHHCCCCEEEEEEEECCCHHHHHHHHCCCCCCCCCCEEEECCCEEEECCCCCCCHHHHHH TLLFEMKRRNVSKGLATLCIGGGMGVAMCVERL HHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHCC >Mature Secondary Structure SNPSIVIASAARTAVGSFNGAFGNTPAHELGAAAVKAVLERAGVEAGEVDEVILGQVLP CCCCEEEEECHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHCCC AGEGQNPARQAAMKAGVPQEKTAWGMNQLCGSGLRAVALGMQQIATGDAKVIVAGGMESM CCCCCCHHHHHHHHCCCCCHHHHCCHHHHHHCCHHHHHHHHHHHCCCCCEEEEECCCHHH SMAPHCAHLRGGVKMGDYKMIDTMIKDGLTDAFYGYHMGTTAENVARKWQLTREEQDEFA CCCCHHHHHHCCCCCCCHHHHHHHHHCCCHHHHHHHCCCCCHHHHHHHHHCCHHHHHHHH LASQNKAEAAQKAGRFADEIVPFVVKTRKGDVTVDQDEYIRHGATLESIAKLRPAFDKEG HHCCCHHHHHHHHHHHHHHHHHHHHEECCCCEEECHHHHHHCCCCHHHHHHHCCCCCCCC TVTAANASGLNDGAAAALLMTEAEAGRRGIQPLARIVSWATAGVDPQIMGTGPIPASRKA CEEECCCCCCCCCHHHHHEEHHHHHHHHHHHHHHHHHHHHHCCCCCEEEECCCCCHHHHH LEKAGWSVAEIELVEANEAFAAQACAVNKDLGWDPSIVNVNGGAIAIGHPIGASGARVLN HHHCCCCEEEEEEEECCCHHHHHHHHCCCCCCCCCCEEEECCCEEEECCCCCCCHHHHHH TLLFEMKRRNVSKGLATLCIGGGMGVAMCVERL HHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 7582015; 11481430 [H]