| Definition | Mycobacterium avium subsp. paratuberculosis K-10, complete genome. |
|---|---|
| Accession | NC_002944 |
| Length | 4,829,781 |
Click here to switch to the map view.
The map label for this gene is thlA [H]
Identifier: 41406784
GI number: 41406784
Start: 706327
End: 707496
Strand: Direct
Name: thlA [H]
Synonym: MAP0686
Alternate gene names: 41406784
Gene position: 706327-707496 (Clockwise)
Preceding gene: 41406783
Following gene: 41406785
Centisome position: 14.62
GC content: 69.74
Gene sequence:
>1170_bases CTGCACCTGCTGGTTGAACTGGAGAAGACTGTGGCTGAAGCCGTCATCGTGTCCGCGCTGCGCACACCCATCGGAACCGC CCGCAAGGGCACCCTGCGCGACACCAGCGCATTCGACCTGGCCCACCACGTCGTCAGCGAAGCGGTGAAAGATATTGACC CGACCCAGGTCGACGACGTGATCCTGGGCGAGGGCCTCTACGGCGGCGGCGTGCTGGCCCGCCACGCGGCCATCACGGCG GGGCTGACCCAGGTGCCCGGCCTGGCCAACAACCGGCACTGCGCGGCGGGTCAGGCGGCCGTACAGAGCGCCGCGGCCAG CGTGCGCGCCGGAATGGACCAACTGGTCATCGCCGGCGGCGTCAACTCGGCTTCCACGTCGCCGCGATCGCGGATGCAGG TCGACGGCGAGTGGGTCGACTGGTTCCCGCCGACCCACCCGGACCGGCCCGACGCCCCGAACATGGACATGTCGATCACC GTCGGCTGGAACGCTGCCGTCAAAGCCGGGGTGAGCCGCGAGGAGATGGACGCCTGGGCGCTGCGGTCGCACCGCAACGC CATCGCCGCCATCGACGAGGGCCGCTTCAAAGAGGAGATCGTGCCCATCGACACCCCGCACGGGCTGTTCTCGGTCGACG AACACCCGCGCCGCGACACCAGCATGGAGAAGTTGGCCGCGCTCAAGCCGTTACATCCGGAAATCGAGGGCTTCTCCATC ACCGCCGGCAACGCCTGCGGCGCCAACGACGGTGCCGCGGTGCTGACGATCGCCAGCGACCGGCTCGGGCTGCGGCCGTT GGCCACCATCCGGTCCTGGGCGTCGGTCGGGGTCGACCCGGCGATCACCGGCCTGGCGCCGGTGGAGGCGATACCGAAAG CCCTTGGACGCGCTGGGCTTTCGATCTCCGATGTGGACCTCTTCGAGATCAACGAGGCCTTCGCGGCGATGTGTGTGGCC ACGGTCAAGCTGCTCGAACTCGACCCGGACAAGGTCAACGTCAGCGGCAGCGGCTGCTCGCTGGGGCATCCCGTGGCGGC GACCGGGGCCCGGATGCTGGTCACCCTGGTGCACGAATTGCGCCGCCGCGGCGGCGGTATCGGCGTCGCGGCGATGTGCG CGGGCGGGGGCATGGGTTCGGCGACGGTGATCGAGGTCGCGGGCGAATAA
Upstream 100 bases:
>100_bases GCACCAACTGACCCGCCGGCCGCCACCCCGCGCTGGTTGCAACTGACGCTCTCCTACTGAGAGAATAATATTCTCGTGAG GTGCGGATGGCGCACGGGCG
Downstream 100 bases:
>100_bases TGCGCACATGACCATCGGAGAGCTGATCGACCGGGCGCGCAACGGATCTCCCCGGGCGGCCGGTCGGCTGCTCAGCCTCG TGGAGGGCGAGCGGCGCGAC
Product: hypothetical protein
Products: NA
Alternate protein names: Acetoacetyl-CoA thiolase [H]
Number of amino acids: Translated: 389; Mature: 389
Protein sequence:
>389_residues MHLLVELEKTVAEAVIVSALRTPIGTARKGTLRDTSAFDLAHHVVSEAVKDIDPTQVDDVILGEGLYGGGVLARHAAITA GLTQVPGLANNRHCAAGQAAVQSAAASVRAGMDQLVIAGGVNSASTSPRSRMQVDGEWVDWFPPTHPDRPDAPNMDMSIT VGWNAAVKAGVSREEMDAWALRSHRNAIAAIDEGRFKEEIVPIDTPHGLFSVDEHPRRDTSMEKLAALKPLHPEIEGFSI TAGNACGANDGAAVLTIASDRLGLRPLATIRSWASVGVDPAITGLAPVEAIPKALGRAGLSISDVDLFEINEAFAAMCVA TVKLLELDPDKVNVSGSGCSLGHPVAATGARMLVTLVHELRRRGGGIGVAAMCAGGGMGSATVIEVAGE
Sequences:
>Translated_389_residues MHLLVELEKTVAEAVIVSALRTPIGTARKGTLRDTSAFDLAHHVVSEAVKDIDPTQVDDVILGEGLYGGGVLARHAAITA GLTQVPGLANNRHCAAGQAAVQSAAASVRAGMDQLVIAGGVNSASTSPRSRMQVDGEWVDWFPPTHPDRPDAPNMDMSIT VGWNAAVKAGVSREEMDAWALRSHRNAIAAIDEGRFKEEIVPIDTPHGLFSVDEHPRRDTSMEKLAALKPLHPEIEGFSI TAGNACGANDGAAVLTIASDRLGLRPLATIRSWASVGVDPAITGLAPVEAIPKALGRAGLSISDVDLFEINEAFAAMCVA TVKLLELDPDKVNVSGSGCSLGHPVAATGARMLVTLVHELRRRGGGIGVAAMCAGGGMGSATVIEVAGE >Mature_389_residues MHLLVELEKTVAEAVIVSALRTPIGTARKGTLRDTSAFDLAHHVVSEAVKDIDPTQVDDVILGEGLYGGGVLARHAAITA GLTQVPGLANNRHCAAGQAAVQSAAASVRAGMDQLVIAGGVNSASTSPRSRMQVDGEWVDWFPPTHPDRPDAPNMDMSIT VGWNAAVKAGVSREEMDAWALRSHRNAIAAIDEGRFKEEIVPIDTPHGLFSVDEHPRRDTSMEKLAALKPLHPEIEGFSI TAGNACGANDGAAVLTIASDRLGLRPLATIRSWASVGVDPAITGLAPVEAIPKALGRAGLSISDVDLFEINEAFAAMCVA TVKLLELDPDKVNVSGSGCSLGHPVAATGARMLVTLVHELRRRGGGIGVAAMCAGGGMGSATVIEVAGE
Specific function: SHORT-CHAIN FATTY ACIDS METABOLISM. [C]
COG id: COG0183
COG function: function code I; Acetyl-CoA acetyltransferase
Gene ontology:
Cell location: Cytoplasm [H]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the thiolase family [H]
Homologues:
Organism=Homo sapiens, GI148539872, Length=389, Percent_Identity=40.6169665809769, Blast_Score=229, Evalue=5e-60, Organism=Homo sapiens, GI4501853, Length=408, Percent_Identity=38.9705882352941, Blast_Score=225, Evalue=4e-59, Organism=Homo sapiens, GI167614485, Length=397, Percent_Identity=38.0352644836272, Blast_Score=223, Evalue=3e-58, Organism=Homo sapiens, GI4557237, Length=394, Percent_Identity=34.2639593908629, Blast_Score=184, Evalue=1e-46, Organism=Homo sapiens, GI4504327, Length=429, Percent_Identity=29.3706293706294, Blast_Score=150, Evalue=3e-36, Organism=Homo sapiens, GI194353979, Length=390, Percent_Identity=30.7692307692308, Blast_Score=148, Evalue=8e-36, Organism=Escherichia coli, GI1788554, Length=398, Percent_Identity=42.2110552763819, Blast_Score=238, Evalue=7e-64, Organism=Escherichia coli, GI87082165, Length=394, Percent_Identity=42.6395939086294, Blast_Score=237, Evalue=8e-64, Organism=Escherichia coli, GI48994986, Length=392, Percent_Identity=36.9897959183673, Blast_Score=209, Evalue=3e-55, Organism=Escherichia coli, GI1787663, Length=400, Percent_Identity=38.75, Blast_Score=199, Evalue=3e-52, Organism=Escherichia coli, GI1788683, Length=408, Percent_Identity=32.5980392156863, Blast_Score=153, Evalue=2e-38, Organism=Caenorhabditis elegans, GI133906874, Length=394, Percent_Identity=36.2944162436548, Blast_Score=199, Evalue=2e-51, Organism=Caenorhabditis elegans, GI25147385, Length=394, Percent_Identity=32.994923857868, Blast_Score=169, Evalue=2e-42, Organism=Caenorhabditis elegans, GI17535921, Length=396, Percent_Identity=30.3030303030303, Blast_Score=152, Evalue=3e-37, Organism=Caenorhabditis elegans, GI17551802, Length=436, Percent_Identity=29.5871559633028, Blast_Score=147, Evalue=8e-36, Organism=Caenorhabditis elegans, GI17535917, Length=386, Percent_Identity=28.2383419689119, Blast_Score=113, Evalue=1e-25, Organism=Saccharomyces cerevisiae, GI6322031, Length=402, Percent_Identity=33.3333333333333, Blast_Score=194, Evalue=2e-50, Organism=Saccharomyces cerevisiae, GI6325229, Length=403, Percent_Identity=34.7394540942928, Blast_Score=191, Evalue=2e-49, Organism=Drosophila melanogaster, GI24655093, Length=395, Percent_Identity=40, Blast_Score=239, Evalue=3e-63, Organism=Drosophila melanogaster, GI24640423, Length=406, Percent_Identity=34.2364532019704, Blast_Score=187, Evalue=1e-47, Organism=Drosophila melanogaster, GI17648125, Length=402, Percent_Identity=33.8308457711443, Blast_Score=183, Evalue=2e-46, Organism=Drosophila melanogaster, GI17137578, Length=431, Percent_Identity=30.8584686774942, Blast_Score=144, Evalue=9e-35,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR002155 - InterPro: IPR016039 - InterPro: IPR016038 - InterPro: IPR020615 - InterPro: IPR020610 - InterPro: IPR020617 - InterPro: IPR020613 - InterPro: IPR020616 [H]
Pfam domain/function: PF02803 Thiolase_C; PF00108 Thiolase_N [H]
EC number: =2.3.1.9 [H]
Molecular weight: Translated: 40359; Mature: 40359
Theoretical pI: Translated: 5.39; Mature: 5.39
Prosite motif: PS00099 THIOLASE_3
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.3 %Cys (Translated Protein) 2.8 %Met (Translated Protein) 4.1 %Cys+Met (Translated Protein) 1.3 %Cys (Mature Protein) 2.8 %Met (Mature Protein) 4.1 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MHLLVELEKTVAEAVIVSALRTPIGTARKGTLRDTSAFDLAHHVVSEAVKDIDPTQVDDV CCEEEHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCHHHHHHHHHHHHHHHCCCCCHHCCE ILGEGLYGGGVLARHAAITAGLTQVPGLANNRHCAAGQAAVQSAAASVRAGMDQLVIAGG EECCCCCCCCHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHCCCCCEEEECC VNSASTSPRSRMQVDGEWVDWFPPTHPDRPDAPNMDMSITVGWNAAVKAGVSREEMDAWA CCCCCCCCCHHEEECCCEEECCCCCCCCCCCCCCCCEEEEECCCHHHHCCCCHHHHHHHH LRSHRNAIAAIDEGRFKEEIVPIDTPHGLFSVDEHPRRDTSMEKLAALKPLHPEIEGFSI HHHCCCEEEEECCCCCHHCCCCCCCCCCCEECCCCCCCCCHHHHHHHHCCCCCCCCCEEE TAGNACGANDGAAVLTIASDRLGLRPLATIRSWASVGVDPAITGLAPVEAIPKALGRAGL ECCCCCCCCCCCEEEEEECCCCCCCHHHHHHHHHHCCCCHHHCCCCHHHHHHHHHHHCCC SISDVDLFEINEAFAAMCVATVKLLELDPDKVNVSGSGCSLGHPVAATGARMLVTLVHEL CCCCCHHHHHHHHHHHHHHHHHHHHCCCCCEEEECCCCCCCCCCHHHHHHHHHHHHHHHH RRRGGGIGVAAMCAGGGMGSATVIEVAGE HHCCCCCEEEEEECCCCCCCEEEEEECCC >Mature Secondary Structure MHLLVELEKTVAEAVIVSALRTPIGTARKGTLRDTSAFDLAHHVVSEAVKDIDPTQVDDV CCEEEHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCHHHHHHHHHHHHHHHCCCCCHHCCE ILGEGLYGGGVLARHAAITAGLTQVPGLANNRHCAAGQAAVQSAAASVRAGMDQLVIAGG EECCCCCCCCHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHCCCCCEEEECC VNSASTSPRSRMQVDGEWVDWFPPTHPDRPDAPNMDMSITVGWNAAVKAGVSREEMDAWA CCCCCCCCCHHEEECCCEEECCCCCCCCCCCCCCCCEEEEECCCHHHHCCCCHHHHHHHH LRSHRNAIAAIDEGRFKEEIVPIDTPHGLFSVDEHPRRDTSMEKLAALKPLHPEIEGFSI HHHCCCEEEEECCCCCHHCCCCCCCCCCCEECCCCCCCCCHHHHHHHHCCCCCCCCCEEE TAGNACGANDGAAVLTIASDRLGLRPLATIRSWASVGVDPAITGLAPVEAIPKALGRAGL ECCCCCCCCCCCEEEEEECCCCCCCHHHHHHHHHHCCCCHHHCCCCHHHHHHHHHHHCCC SISDVDLFEINEAFAAMCVATVKLLELDPDKVNVSGSGCSLGHPVAATGARMLVTLVHEL CCCCCHHHHHHHHHHHHHHHHHHHHCCCCCEEEECCCCCCCCCCHHHHHHHHHHHHHHHH RRRGGGIGVAAMCAGGGMGSATVIEVAGE HHCCCCCEEEEEECCCCCCCEEEEEECCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 7867955; 11075929; 11466286; 1685080 [H]