Definition Clostridium botulinum A str. Hall, complete genome.
Accession NC_009698
Length 3,760,560

Click here to switch to the map view.

The map label for this gene is lip2 [H]

Identifier: 153935610

GI number: 153935610

Start: 2262617

End: 2263663

Strand: Reverse

Name: lip2 [H]

Synonym: CLC_2129

Alternate gene names: 153935610

Gene position: 2263663-2262617 (Counterclockwise)

Preceding gene: 153936940

Following gene: 153937509

Centisome position: 60.19

GC content: 31.23

Gene sequence:

>1047_bases
ATGGAGGTAAATGGAGTGAAAAAAGTAATTAAAGTAGTATCAGTTATTCTAGTTATACTTGTAATAGCAGGATTTTTTAT
TATTAAGAATTTAACTGAGACCAAGGATGGTAAGCTTAATATGTATGTTGCTGCAAACTTACAGTTATATAAAATTCTTA
ATCCTAAATCACTCAATAATAAATCAATTGAAGAAACTAGAGGAGCTTTAAATAAGCAATCAACTAGGTGGTCAAATAAA
CCTATACCATTTTCTAATATTAAGAACCTTGATATAAAAATGAACAATGAGAAAATACCAGTAAGAATATATACACCTGA
AAAGGGTAGCAATTTCCCTATAATCATTTATTCACATGGTGGTTTCTGGATTGGAGGAAATGTTGATACTATTGATGGGG
TTTGTAGAAAGCTTTCACAGAATACAAAAGCAATTGTAATATCTGTAAACTATAGGCTTGCCCCAGAAAATCCTTTCCCC
GCTGGTCTTAATGATGTATATAATGTGCTTCAGTGGACTTATAAAAATGGAAAAAGCATAAATGGAGATGAAAAACATAT
AGCAGTTGTAGGGGACAGTGCAGGTGGAAATCTTTCTGCTGCAGTTTCATCAATGTCACGGGATAAAAATGGACCTTCTA
TAACATGTCAGGTATTAATATATCCATCAACAAATATATTTAAACTGAACAGTAAATCTTGGTCTCATTTTTCTAATAGC
TTTAATGTTTCAACAGAGGATATGGAAAAGTATATTTCAATTTATGCACCAAAAAAAGAAGATAGAAAAAGCCCTTATGC
ATCCCCACTTTTATCTAAGGATCTTAGAAAATTACCTGATACACTCGTAGTGACAGCAGAAATTGATCCTCTTAGAGATG
AAGGGGAAGCTTATGCTAATAAACTAAAAGAATCTGGGGTTAAAGCAGAGGTTACTAGATATAAAGGTATTACTCATGGA
TTTATTACAATGGATAAGATTACAAATAAAGCAGACGAAGCATTAAATCAAATTTCTCTATATATACAAAAAGAGTTTCA
AAAATAA

Upstream 100 bases:

>100_bases
CTAGAAATTAATGTTCAAAGATTTTAAGTATATTAAAATGCGTAAAGGAAAAAATATATAAGTAAATTTAGTTATTTTTA
TTGCAGAATTTCTATAGTGG

Downstream 100 bases:

>100_bases
ACTTAATATAATTATTTTGCTACAAAATTTATTATAGAGGATGTTGCAGAGATAAAAGTTAAGTTTAGTTGACAAATTGC
CATCTTTACTTGATAGAAAA

Product: putative lipase/esterase

Products: NA

Alternate protein names: Triacylglycerol lipase [H]

Number of amino acids: Translated: 348; Mature: 348

Protein sequence:

>348_residues
MEVNGVKKVIKVVSVILVILVIAGFFIIKNLTETKDGKLNMYVAANLQLYKILNPKSLNNKSIEETRGALNKQSTRWSNK
PIPFSNIKNLDIKMNNEKIPVRIYTPEKGSNFPIIIYSHGGFWIGGNVDTIDGVCRKLSQNTKAIVISVNYRLAPENPFP
AGLNDVYNVLQWTYKNGKSINGDEKHIAVVGDSAGGNLSAAVSSMSRDKNGPSITCQVLIYPSTNIFKLNSKSWSHFSNS
FNVSTEDMEKYISIYAPKKEDRKSPYASPLLSKDLRKLPDTLVVTAEIDPLRDEGEAYANKLKESGVKAEVTRYKGITHG
FITMDKITNKADEALNQISLYIQKEFQK

Sequences:

>Translated_348_residues
MEVNGVKKVIKVVSVILVILVIAGFFIIKNLTETKDGKLNMYVAANLQLYKILNPKSLNNKSIEETRGALNKQSTRWSNK
PIPFSNIKNLDIKMNNEKIPVRIYTPEKGSNFPIIIYSHGGFWIGGNVDTIDGVCRKLSQNTKAIVISVNYRLAPENPFP
AGLNDVYNVLQWTYKNGKSINGDEKHIAVVGDSAGGNLSAAVSSMSRDKNGPSITCQVLIYPSTNIFKLNSKSWSHFSNS
FNVSTEDMEKYISIYAPKKEDRKSPYASPLLSKDLRKLPDTLVVTAEIDPLRDEGEAYANKLKESGVKAEVTRYKGITHG
FITMDKITNKADEALNQISLYIQKEFQK
>Mature_348_residues
MEVNGVKKVIKVVSVILVILVIAGFFIIKNLTETKDGKLNMYVAANLQLYKILNPKSLNNKSIEETRGALNKQSTRWSNK
PIPFSNIKNLDIKMNNEKIPVRIYTPEKGSNFPIIIYSHGGFWIGGNVDTIDGVCRKLSQNTKAIVISVNYRLAPENPFP
AGLNDVYNVLQWTYKNGKSINGDEKHIAVVGDSAGGNLSAAVSSMSRDKNGPSITCQVLIYPSTNIFKLNSKSWSHFSNS
FNVSTEDMEKYISIYAPKKEDRKSPYASPLLSKDLRKLPDTLVVTAEIDPLRDEGEAYANKLKESGVKAEVTRYKGITHG
FITMDKITNKADEALNQISLYIQKEFQK

Specific function: Has An Esterase Activity. Triacetyl Glycerol (Triacetin) Is A Substrate Of The Enzyme. [C]

COG id: COG0657

COG function: function code I; Esterase/lipase

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the 'GDXG' lipolytic enzyme family [H]

Homologues:

Organism=Homo sapiens, GI68299767, Length=304, Percent_Identity=28.2894736842105, Blast_Score=99, Evalue=6e-21,
Organism=Homo sapiens, GI61966717, Length=289, Percent_Identity=26.2975778546713, Blast_Score=91, Evalue=2e-18,
Organism=Homo sapiens, GI157041239, Length=288, Percent_Identity=25, Blast_Score=88, Evalue=1e-17,
Organism=Homo sapiens, GI206597554, Length=290, Percent_Identity=27.5862068965517, Blast_Score=82, Evalue=8e-16,
Organism=Homo sapiens, GI68051721, Length=167, Percent_Identity=26.9461077844311, Blast_Score=70, Evalue=4e-12,
Organism=Escherichia coli, GI1786682, Length=282, Percent_Identity=26.5957446808511, Blast_Score=108, Evalue=6e-25,
Organism=Caenorhabditis elegans, GI17567059, Length=276, Percent_Identity=31.5217391304348, Blast_Score=128, Evalue=6e-30,
Organism=Caenorhabditis elegans, GI17540028, Length=279, Percent_Identity=28.3154121863799, Blast_Score=101, Evalue=5e-22,
Organism=Caenorhabditis elegans, GI71996133, Length=269, Percent_Identity=27.1375464684015, Blast_Score=99, Evalue=3e-21,
Organism=Caenorhabditis elegans, GI72001146, Length=143, Percent_Identity=32.8671328671329, Blast_Score=88, Evalue=5e-18,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR013094
- InterPro:   IPR002168 [H]

Pfam domain/function: PF07859 Abhydrolase_3 [H]

EC number: =3.1.1.3 [H]

Molecular weight: Translated: 38829; Mature: 38829

Theoretical pI: Translated: 9.93; Mature: 9.93

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.6 %Cys     (Translated Protein)
1.7 %Met     (Translated Protein)
2.3 %Cys+Met (Translated Protein)
0.6 %Cys     (Mature Protein)
1.7 %Met     (Mature Protein)
2.3 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MEVNGVKKVIKVVSVILVILVIAGFFIIKNLTETKDGKLNMYVAANLQLYKILNPKSLNN
CCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCEEEEEEEECEEEEEEECCCCCCC
KSIEETRGALNKQSTRWSNKPIPFSNIKNLDIKMNNEKIPVRIYTPEKGSNFPIIIYSHG
CCHHHHHHHHCCCCCCCCCCCCCCCCCCEEEEEECCCEEEEEEECCCCCCCCCEEEECCC
GFWIGGNVDTIDGVCRKLSQNTKAIVISVNYRLAPENPFPAGLNDVYNVLQWTYKNGKSI
CEEECCCCCHHHHHHHHHCCCCEEEEEEEEEEECCCCCCCCCHHHHHHHHHHHHCCCCCC
NGDEKHIAVVGDSAGGNLSAAVSSMSRDKNGPSITCQVLIYPSTNIFKLNSKSWSHFSNS
CCCCCEEEEEECCCCCCHHHHHHHHHCCCCCCEEEEEEEEECCCCEEEECCCCCHHCCCC
FNVSTEDMEKYISIYAPKKEDRKSPYASPLLSKDLRKLPDTLVVTAEIDPLRDEGEAYAN
CCCCHHHHHHHHEEECCCCHHCCCCCCCHHHHHHHHHCCCEEEEEEECCCCCCHHHHHHH
KLKESGVKAEVTRYKGITHGFITMDKITNKADEALNQISLYIQKEFQK
HHHHCCCEEEEHHHCCCCCCEEEHHHHCCHHHHHHHHHHHHHHHHHCC
>Mature Secondary Structure
MEVNGVKKVIKVVSVILVILVIAGFFIIKNLTETKDGKLNMYVAANLQLYKILNPKSLNN
CCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCEEEEEEEECEEEEEEECCCCCCC
KSIEETRGALNKQSTRWSNKPIPFSNIKNLDIKMNNEKIPVRIYTPEKGSNFPIIIYSHG
CCHHHHHHHHCCCCCCCCCCCCCCCCCCEEEEEECCCEEEEEEECCCCCCCCCEEEECCC
GFWIGGNVDTIDGVCRKLSQNTKAIVISVNYRLAPENPFPAGLNDVYNVLQWTYKNGKSI
CEEECCCCCHHHHHHHHHCCCCEEEEEEEEEEECCCCCCCCCHHHHHHHHHHHHCCCCCC
NGDEKHIAVVGDSAGGNLSAAVSSMSRDKNGPSITCQVLIYPSTNIFKLNSKSWSHFSNS
CCCCCEEEEEECCCCCCHHHHHHHHHCCCCCCEEEEEEEEECCCCEEEECCCCCHHCCCC
FNVSTEDMEKYISIYAPKKEDRKSPYASPLLSKDLRKLPDTLVVTAEIDPLRDEGEAYAN
CCCCHHHHHHHHEEECCCCHHCCCCCCCHHHHHHHHHCCCEEEEEEECCCCCCHHHHHHH
KLKESGVKAEVTRYKGITHGFITMDKITNKADEALNQISLYIQKEFQK
HHHHCCCEEEEHHHCCCCCCEEEHHHHCCHHHHHHHHHHHHHHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: 1907455 [H]