Definition Clostridium perfringens str. 13, complete genome.
Accession NC_003366
Length 3,031,430

Click here to switch to the map view.

The map label for this gene is pepA

Identifier: 18311483

GI number: 18311483

Start: 2864622

End: 2866103

Strand: Reverse

Name: pepA

Synonym: CPE2501

Alternate gene names: 18311483

Gene position: 2866103-2864622 (Counterclockwise)

Preceding gene: 18311484

Following gene: 18311481

Centisome position: 94.55

GC content: 31.17

Gene sequence:

>1482_bases
ATGTATAATTTTTTAGTGAAAAAATCAAAGTGTACAGAGACAGATGCATTATTAATACCATATTTTGAAGAAAAAACGAA
TATACCTAATGAAGAAATAAACAATAAGATAAATATACTTAAGAAAAAAGAACAATTTAAAGGCTCTTATGGAGAAATAT
TTAATATAACTAGAACAACTGATGATAATATACAAGATATTATATTATTAGGTCTTGGAAAAGAGACAGAGATAACTAAA
GAAAAAATTAGAAGAGCTTTTGGTAAAGCTGTAAATGAGATTAAGAGATTAAAAAGTAAAAGTGTATTTTTAAGATTTGA
TTCAGTAGAGGCTATTGGCTTAGAAAATACATTAAAAGCAATGGTTGAAGGATTAGCCTTAGGATCATACTCATTTAATA
AATATAAGAGTGATAAAAAAGAAGAGGTTGAAGTTACAGTTCATATTGGTGGACACAATATAAATGAAGAAGAGGTAGAG
CTTTGTGAGAAAGCTATTGATGAGGCTATGCTTCTTTCAGAGACTACTTGCTTAGCAAGAGATTTAGTAAATGAACCTGC
TAATAATATGTATCCAGAAACTTTAGCTAAAGAGGTTAAAAACATAGGTTCTAAATATGGATTTGAAGTTGAAGTATTTG
ATGAAAATCAAATAGAAGAATTAAAAATGGAATCTTTCTTATCAGTAGGAAAAGGATCAGATAATTTACCTAGACTTATA
GTTATGAGATACTTTGGAGATAAGGATAATATGGATCAAAGGTTAGCCTTAGTAGGAAAGGGATTAACATATGATTCAGG
TGGTTATTCTTTAAAAACTAATGCTGGAATGGTAACAATGAAGGCTGATATGGGTGGAGCTGCTTCTGTAATAGGAGCAA
TAAGTGCCATAGCTAAAAGAAATTTAAAAATAAATGTAATAGCCGTGGTAGCTGCTTGTGAAAACTTAATATCAGGTCAT
GCTTATAAGCCAGGGGATATTATAGGTTCAATGGAAGGAAAAACTATAGAAATATTAAATACAGATGCTGAAGGAAGACT
TACTTTAATAGATGCTGTAACTTATGCTATAGAAAAAGAAAAGGCTAGTGAGATAATCGATGTGGCTACATTAACTGGGG
CTGCCGTAGTTTCTTTAGGAGAGGATGTTACAGCCGTAATAACTAATAAGGATGAATTCTATGGAGAGTTAAGAGAAGCT
TCTTATGAGACTGGAGAAAAGGTATGGCAAATGCCTAGCTTTGAAGATTACGGTAAGCTTATAAAGTCTAATATAGCAGA
TTTAAAAAATATAGGTGGAAAGTATGCAGGAACAATAACTGCAGGATTATTTATTGGAGAATTTATTCAAAATAAACCTT
GGTTACACTTAGATATAGCTGGCCCAGCATTCTCAGAGAAAAAAGGAGATTATTGTCCAACTGGAGGAACAGGTGCAGGA
GTTAGAACTTTATATGAATTAGCTAATAGAAGATGTAAATAA

Upstream 100 bases:

>100_bases
AGGTTACATATTTTTTTATAAATTAGGTATATATTAAAGATAGATTATTAAAGGTAAGTGTGATATATTAATTATAAAAA
TTTAAAGAGGTGGAAAATAA

Downstream 100 bases:

>100_bases
TATAAGATTATAACCTTTATTAATTTTAAAAGCTAATAGTTAATAAATAAAAAATATGTGTATCAAAATAACTTTTTATA
AAACTTACAAACAGTATGAA

Product: leucyl aminopeptidase

Products: NA

Alternate protein names: Leucine aminopeptidase; LAP; Leucyl aminopeptidase

Number of amino acids: Translated: 493; Mature: 493

Protein sequence:

>493_residues
MYNFLVKKSKCTETDALLIPYFEEKTNIPNEEINNKINILKKKEQFKGSYGEIFNITRTTDDNIQDIILLGLGKETEITK
EKIRRAFGKAVNEIKRLKSKSVFLRFDSVEAIGLENTLKAMVEGLALGSYSFNKYKSDKKEEVEVTVHIGGHNINEEEVE
LCEKAIDEAMLLSETTCLARDLVNEPANNMYPETLAKEVKNIGSKYGFEVEVFDENQIEELKMESFLSVGKGSDNLPRLI
VMRYFGDKDNMDQRLALVGKGLTYDSGGYSLKTNAGMVTMKADMGGAASVIGAISAIAKRNLKINVIAVVAACENLISGH
AYKPGDIIGSMEGKTIEILNTDAEGRLTLIDAVTYAIEKEKASEIIDVATLTGAAVVSLGEDVTAVITNKDEFYGELREA
SYETGEKVWQMPSFEDYGKLIKSNIADLKNIGGKYAGTITAGLFIGEFIQNKPWLHLDIAGPAFSEKKGDYCPTGGTGAG
VRTLYELANRRCK

Sequences:

>Translated_493_residues
MYNFLVKKSKCTETDALLIPYFEEKTNIPNEEINNKINILKKKEQFKGSYGEIFNITRTTDDNIQDIILLGLGKETEITK
EKIRRAFGKAVNEIKRLKSKSVFLRFDSVEAIGLENTLKAMVEGLALGSYSFNKYKSDKKEEVEVTVHIGGHNINEEEVE
LCEKAIDEAMLLSETTCLARDLVNEPANNMYPETLAKEVKNIGSKYGFEVEVFDENQIEELKMESFLSVGKGSDNLPRLI
VMRYFGDKDNMDQRLALVGKGLTYDSGGYSLKTNAGMVTMKADMGGAASVIGAISAIAKRNLKINVIAVVAACENLISGH
AYKPGDIIGSMEGKTIEILNTDAEGRLTLIDAVTYAIEKEKASEIIDVATLTGAAVVSLGEDVTAVITNKDEFYGELREA
SYETGEKVWQMPSFEDYGKLIKSNIADLKNIGGKYAGTITAGLFIGEFIQNKPWLHLDIAGPAFSEKKGDYCPTGGTGAG
VRTLYELANRRCK
>Mature_493_residues
MYNFLVKKSKCTETDALLIPYFEEKTNIPNEEINNKINILKKKEQFKGSYGEIFNITRTTDDNIQDIILLGLGKETEITK
EKIRRAFGKAVNEIKRLKSKSVFLRFDSVEAIGLENTLKAMVEGLALGSYSFNKYKSDKKEEVEVTVHIGGHNINEEEVE
LCEKAIDEAMLLSETTCLARDLVNEPANNMYPETLAKEVKNIGSKYGFEVEVFDENQIEELKMESFLSVGKGSDNLPRLI
VMRYFGDKDNMDQRLALVGKGLTYDSGGYSLKTNAGMVTMKADMGGAASVIGAISAIAKRNLKINVIAVVAACENLISGH
AYKPGDIIGSMEGKTIEILNTDAEGRLTLIDAVTYAIEKEKASEIIDVATLTGAAVVSLGEDVTAVITNKDEFYGELREA
SYETGEKVWQMPSFEDYGKLIKSNIADLKNIGGKYAGTITAGLFIGEFIQNKPWLHLDIAGPAFSEKKGDYCPTGGTGAG
VRTLYELANRRCK

Specific function: Presumably involved in the processing and regular turnover of intracellular proteins. Catalyzes the removal of unsubstituted N-terminal amino acids from various peptides

COG id: COG0260

COG function: function code E; Leucyl aminopeptidase

Gene ontology:

Cell location: Cytoplasm

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the peptidase M17 family

Homologues:

Organism=Homo sapiens, GI41393561, Length=444, Percent_Identity=39.8648648648649, Blast_Score=276, Evalue=3e-74,
Organism=Homo sapiens, GI47155554, Length=322, Percent_Identity=37.2670807453416, Blast_Score=167, Evalue=3e-41,
Organism=Escherichia coli, GI1790710, Length=494, Percent_Identity=35.4251012145749, Blast_Score=288, Evalue=7e-79,
Organism=Escherichia coli, GI87082123, Length=317, Percent_Identity=38.4858044164038, Blast_Score=197, Evalue=2e-51,
Organism=Caenorhabditis elegans, GI17556903, Length=323, Percent_Identity=39.0092879256966, Blast_Score=179, Evalue=4e-45,
Organism=Caenorhabditis elegans, GI17565172, Length=223, Percent_Identity=34.0807174887892, Blast_Score=97, Evalue=1e-20,
Organism=Drosophila melanogaster, GI24661038, Length=443, Percent_Identity=30.2483069977427, Blast_Score=194, Evalue=1e-49,
Organism=Drosophila melanogaster, GI21355725, Length=441, Percent_Identity=30.1587301587302, Blast_Score=193, Evalue=2e-49,
Organism=Drosophila melanogaster, GI24662227, Length=456, Percent_Identity=27.1929824561404, Blast_Score=171, Evalue=8e-43,
Organism=Drosophila melanogaster, GI161077148, Length=340, Percent_Identity=30.8823529411765, Blast_Score=169, Evalue=3e-42,
Organism=Drosophila melanogaster, GI20130057, Length=340, Percent_Identity=30.8823529411765, Blast_Score=169, Evalue=3e-42,
Organism=Drosophila melanogaster, GI20129969, Length=298, Percent_Identity=30.5369127516779, Blast_Score=162, Evalue=3e-40,
Organism=Drosophila melanogaster, GI21355645, Length=477, Percent_Identity=26.8343815513627, Blast_Score=161, Evalue=1e-39,
Organism=Drosophila melanogaster, GI24662223, Length=477, Percent_Identity=26.8343815513627, Blast_Score=161, Evalue=1e-39,
Organism=Drosophila melanogaster, GI19922386, Length=471, Percent_Identity=27.8131634819533, Blast_Score=160, Evalue=1e-39,
Organism=Drosophila melanogaster, GI21357381, Length=335, Percent_Identity=34.0298507462687, Blast_Score=160, Evalue=2e-39,
Organism=Drosophila melanogaster, GI221379063, Length=335, Percent_Identity=34.0298507462687, Blast_Score=160, Evalue=2e-39,
Organism=Drosophila melanogaster, GI221379062, Length=335, Percent_Identity=34.0298507462687, Blast_Score=160, Evalue=2e-39,
Organism=Drosophila melanogaster, GI20129963, Length=442, Percent_Identity=27.8280542986425, Blast_Score=160, Evalue=3e-39,
Organism=Drosophila melanogaster, GI24646701, Length=259, Percent_Identity=30.1158301158301, Blast_Score=95, Evalue=1e-19,
Organism=Drosophila melanogaster, GI24646703, Length=259, Percent_Identity=30.1158301158301, Blast_Score=95, Evalue=1e-19,
Organism=Drosophila melanogaster, GI21358201, Length=259, Percent_Identity=30.1158301158301, Blast_Score=95, Evalue=1e-19,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): AMPA_CLOPE (Q8XHI3)

Other databases:

- EMBL:   BA000016
- RefSeq:   NP_563417.1
- ProteinModelPortal:   Q8XHI3
- SMR:   Q8XHI3
- MEROPS:   M17.010
- GeneID:   990879
- GenomeReviews:   BA000016_GR
- KEGG:   cpe:CPE2501
- NMPDR:   fig|195102.1.peg.2564
- HOGENOM:   HBG742580
- OMA:   NMHLMRY
- PhylomeDB:   Q8XHI3
- ProtClustDB:   PRK00913
- BioCyc:   CPER195102:CPE2501-MONOMER
- BRENDA:   3.4.11.1
- GO:   GO:0005737
- GO:   GO:0006508
- HAMAP:   MF_00181
- InterPro:   IPR011356
- InterPro:   IPR000819
- InterPro:   IPR023042
- InterPro:   IPR008283
- PANTHER:   PTHR11963:SF3
- PRINTS:   PR00481

Pfam domain/function: PF00883 Peptidase_M17; PF02789 Peptidase_M17_N

EC number: =3.4.11.1; =3.4.11.10

Molecular weight: Translated: 54308; Mature: 54308

Theoretical pI: Translated: 4.90; Mature: 4.90

Prosite motif: PS00631 CYTOSOL_AP

Important sites: ACT_SITE 272-272 ACT_SITE 346-346

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.2 %Cys     (Translated Protein)
2.4 %Met     (Translated Protein)
3.7 %Cys+Met (Translated Protein)
1.2 %Cys     (Mature Protein)
2.4 %Met     (Mature Protein)
3.7 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MYNFLVKKSKCTETDALLIPYFEEKTNIPNEEINNKINILKKKEQFKGSYGEIFNITRTT
CCCCEEECCCCCCCCEEEEEEEHHCCCCCHHHHCCHHHHEECHHHHCCCCCCEEEEEECC
DDNIQDIILLGLGKETEITKEKIRRAFGKAVNEIKRLKSKSVFLRFDSVEAIGLENTLKA
CCCCCEEEEEECCCCCHHHHHHHHHHHHHHHHHHHHHCCCEEEEEECCEEEECHHHHHHH
MVEGLALGSYSFNKYKSDKKEEVEVTVHIGGHNINEEEVELCEKAIDEAMLLSETTCLAR
HHHHHHCCCCCCHHHCCCCCCEEEEEEEECCCCCCHHHHHHHHHHHHHHHHHHHHHHHHH
DLVNEPANNMYPETLAKEVKNIGSKYGFEVEVFDENQIEELKMESFLSVGKGSDNLPRLI
HHHCCCCCCCCHHHHHHHHHHHHHHCCCEEEEECCCCHHHHHHHHHHHHCCCCCCCCEEE
VMRYFGDKDNMDQRLALVGKGLTYDSGGYSLKTNAGMVTMKADMGGAASVIGAISAIAKR
EEEECCCCCCHHHHHHHHCCCCEECCCCEEEECCCCEEEEECCCCCHHHHHHHHHHHHHC
NLKINVIAVVAACENLISGHAYKPGDIIGSMEGKTIEILNTDAEGRLTLIDAVTYAIEKE
CCEEEEEHHHHHHHHHHCCCCCCCCCEEECCCCCEEEEEECCCCCCEEHHHHHHHHHHHH
KASEIIDVATLTGAAVVSLGEDVTAVITNKDEFYGELREASYETGEKVWQMPSFEDYGKL
HHHHHHHHHHHHHHHHEECCCCEEEEEECCHHHHHHHHHHHHHHHHHHHCCCCHHHHHHH
IKSNIADLKNIGGKYAGTITAGLFIGEFIQNKPWLHLDIAGPAFSEKKGDYCPTGGTGAG
HHHHHHHHHHCCCCHHHHHHHHHHHHHHHCCCCCEEEEECCCCCCCCCCCCCCCCCCCHH
VRTLYELANRRCK
HHHHHHHHHCCCC
>Mature Secondary Structure
MYNFLVKKSKCTETDALLIPYFEEKTNIPNEEINNKINILKKKEQFKGSYGEIFNITRTT
CCCCEEECCCCCCCCEEEEEEEHHCCCCCHHHHCCHHHHEECHHHHCCCCCCEEEEEECC
DDNIQDIILLGLGKETEITKEKIRRAFGKAVNEIKRLKSKSVFLRFDSVEAIGLENTLKA
CCCCCEEEEEECCCCCHHHHHHHHHHHHHHHHHHHHHCCCEEEEEECCEEEECHHHHHHH
MVEGLALGSYSFNKYKSDKKEEVEVTVHIGGHNINEEEVELCEKAIDEAMLLSETTCLAR
HHHHHHCCCCCCHHHCCCCCCEEEEEEEECCCCCCHHHHHHHHHHHHHHHHHHHHHHHHH
DLVNEPANNMYPETLAKEVKNIGSKYGFEVEVFDENQIEELKMESFLSVGKGSDNLPRLI
HHHCCCCCCCCHHHHHHHHHHHHHHCCCEEEEECCCCHHHHHHHHHHHHCCCCCCCCEEE
VMRYFGDKDNMDQRLALVGKGLTYDSGGYSLKTNAGMVTMKADMGGAASVIGAISAIAKR
EEEECCCCCCHHHHHHHHCCCCEECCCCEEEECCCCEEEEECCCCCHHHHHHHHHHHHHC
NLKINVIAVVAACENLISGHAYKPGDIIGSMEGKTIEILNTDAEGRLTLIDAVTYAIEKE
CCEEEEEHHHHHHHHHHCCCCCCCCCEEECCCCCEEEEEECCCCCCEEHHHHHHHHHHHH
KASEIIDVATLTGAAVVSLGEDVTAVITNKDEFYGELREASYETGEKVWQMPSFEDYGKL
HHHHHHHHHHHHHHHHEECCCCEEEEEECCHHHHHHHHHHHHHHHHHHHCCCCHHHHHHH
IKSNIADLKNIGGKYAGTITAGLFIGEFIQNKPWLHLDIAGPAFSEKKGDYCPTGGTGAG
HHHHHHHHHHCCCCHHHHHHHHHHHHHHHCCCCCEEEEECCCCCCCCCCCCCCCCCCCHH
VRTLYELANRRCK
HHHHHHHHHCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 11792842