Definition Chromohalobacter salexigens DSM 3043 chromosome, complete genome.
Accession NC_007963
Length 3,696,649

Click here to switch to the map view.

The map label for this gene is pepP [H]

Identifier: 92112160

GI number: 92112160

Start: 28632

End: 29969

Strand: Direct

Name: pepP [H]

Synonym: Csal_0024

Alternate gene names: 92112160

Gene position: 28632-29969 (Clockwise)

Preceding gene: 92112159

Following gene: 92112161

Centisome position: 0.77

GC content: 66.59

Gene sequence:

>1338_bases
ATGCCCCGCACTCCCCTGCCGCGTCCTGCGGCGATCTCTCCTGCCGAATACCGTGCCCGCCGCCAGTCGCTGATGGCGGC
CCTGCCGCCGCAAAGCGCCGTGCTGCTCTCGGCAGCCTCGTTGAAGACCCGCAATCGCGACAGCGAATACCCGTTTCGCC
AGGACAGCGATTTTCATTACCTGAGCGGTTTTCCCGAGCCGGATGCCCTGCTGGTGCTGCTACCCGGCCGCGAGGACGGC
GAGGCGGTGCTGTTCTGCCAGGAAAAGGATCCGCACATGGAGGCCTGGACCGGCCTTCGCATCGGTGCCGAGAAGGCCGT
GACGACGTACGGTCTGGATGCGGCCTACGAAAACGACGAACGCGATGCCCTCCTGCCCGAGCTGCTCGATGGCCGTGAAA
CGCTTTACCTGCCCTTCGACGACGGCGAGACCTTGGCCCTGGCCGAGTCCCTGCGCGCCGAGCTGGCGGCCCAGGCACGA
CGGGGCGCGCGCGCGCCACGCGCCTTCGCCGATGTGGCGCCGTTGATCCACGAGCGCCGCCTGATCAAGAGCGAGGCGGA
ACTCGACCTCATGCGTCATGCGGCACGCATTTCAGCGGCGGCTCATCGGCGTGCCATGCGGAGCGTGTGCCCCGGCCTGC
AGGAGTATCAGCTGCAGGCGGAGCTCGAACACGAATTCGCCTGGCACGGCGCCCGTGCGCCGGCCTATGCGACGATCGTC
GGCGGCGGCGAGAACGCCTGTGTGCTGCACTATATCGAAAACGGCGCGACGCTGAACGATGGCGACCTGGTGCTGATCGA
TGCCGGTGGCGAGTTCGACCTCTACGCCGGTGACATCACCCGCACCTTTCCGGTCAATGGGCGTTTCTCCTCGGCCCAGC
GAGAGCTTTATGACCTCGTGCTCGAGGCCCAGTGCCGTGCCGTGGCGGCCGTCGCGCCCGGCACGACATTGCAGGCGATA
CACGAAGGCGTCGTGCGTGACCTGACCGACGGGCTCATTCGCCTGGGCTTGCTCGAAGGTCCGCTCGAGACGCGTATCGA
CGACCACGGGTACCGGCGTTTCTTCCTGCATGCGACCTCGCACTGGCTGGGGCTCGACGTGCATGACGTCGGCGACTATC
GCCTGGAGGGACAGCCACGCGAGCTGATGCCGGGCATGGTGCTGACCGTGGAGCCCGGACTCTACATCCCCGACGCCGAG
GATATTCCCGAGGCGTATCGGGGCATCGGCATTCGCATCGAGGACGATGTGGCGGTGACCGCTACGGGTCGGGAGGTGCT
GACGACGGATGTGCCGAAATCGGTGGCGGATATCGAGGCGCTCATGCATGACCGTTGA

Upstream 100 bases:

>100_bases
GACACCGAGGATGACGGCAGCACGCCGCCCGACCAGACACACTGATGGGCTCGCGCGCCGGGGTGCGCCCCGGCGTGCCC
CCGCGACCGAGGAGCTTGTC

Downstream 100 bases:

>100_bases
TCAATTTTTGATCGCCATGAATGATCTTTACGTAATTACGTTATGAATACGTAAGCGCGGTGGCCGTGGCCGGGAGAGGC
CCGCCACGACTGCCGTGCAT

Product: aminopeptidase P

Products: NA

Alternate protein names: Aminoacylproline aminopeptidase; Aminopeptidase P II; APP-II; X-Pro aminopeptidase [H]

Number of amino acids: Translated: 445; Mature: 444

Protein sequence:

>445_residues
MPRTPLPRPAAISPAEYRARRQSLMAALPPQSAVLLSAASLKTRNRDSEYPFRQDSDFHYLSGFPEPDALLVLLPGREDG
EAVLFCQEKDPHMEAWTGLRIGAEKAVTTYGLDAAYENDERDALLPELLDGRETLYLPFDDGETLALAESLRAELAAQAR
RGARAPRAFADVAPLIHERRLIKSEAELDLMRHAARISAAAHRRAMRSVCPGLQEYQLQAELEHEFAWHGARAPAYATIV
GGGENACVLHYIENGATLNDGDLVLIDAGGEFDLYAGDITRTFPVNGRFSSAQRELYDLVLEAQCRAVAAVAPGTTLQAI
HEGVVRDLTDGLIRLGLLEGPLETRIDDHGYRRFFLHATSHWLGLDVHDVGDYRLEGQPRELMPGMVLTVEPGLYIPDAE
DIPEAYRGIGIRIEDDVAVTATGREVLTTDVPKSVADIEALMHDR

Sequences:

>Translated_445_residues
MPRTPLPRPAAISPAEYRARRQSLMAALPPQSAVLLSAASLKTRNRDSEYPFRQDSDFHYLSGFPEPDALLVLLPGREDG
EAVLFCQEKDPHMEAWTGLRIGAEKAVTTYGLDAAYENDERDALLPELLDGRETLYLPFDDGETLALAESLRAELAAQAR
RGARAPRAFADVAPLIHERRLIKSEAELDLMRHAARISAAAHRRAMRSVCPGLQEYQLQAELEHEFAWHGARAPAYATIV
GGGENACVLHYIENGATLNDGDLVLIDAGGEFDLYAGDITRTFPVNGRFSSAQRELYDLVLEAQCRAVAAVAPGTTLQAI
HEGVVRDLTDGLIRLGLLEGPLETRIDDHGYRRFFLHATSHWLGLDVHDVGDYRLEGQPRELMPGMVLTVEPGLYIPDAE
DIPEAYRGIGIRIEDDVAVTATGREVLTTDVPKSVADIEALMHDR
>Mature_444_residues
PRTPLPRPAAISPAEYRARRQSLMAALPPQSAVLLSAASLKTRNRDSEYPFRQDSDFHYLSGFPEPDALLVLLPGREDGE
AVLFCQEKDPHMEAWTGLRIGAEKAVTTYGLDAAYENDERDALLPELLDGRETLYLPFDDGETLALAESLRAELAAQARR
GARAPRAFADVAPLIHERRLIKSEAELDLMRHAARISAAAHRRAMRSVCPGLQEYQLQAELEHEFAWHGARAPAYATIVG
GGENACVLHYIENGATLNDGDLVLIDAGGEFDLYAGDITRTFPVNGRFSSAQRELYDLVLEAQCRAVAAVAPGTTLQAIH
EGVVRDLTDGLIRLGLLEGPLETRIDDHGYRRFFLHATSHWLGLDVHDVGDYRLEGQPRELMPGMVLTVEPGLYIPDAED
IPEAYRGIGIRIEDDVAVTATGREVLTTDVPKSVADIEALMHDR

Specific function: Unknown

COG id: COG0006

COG function: function code E; Xaa-Pro aminopeptidase

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the peptidase M24B family [H]

Homologues:

Organism=Homo sapiens, GI11559925, Length=456, Percent_Identity=37.0614035087719, Blast_Score=270, Evalue=1e-72,
Organism=Homo sapiens, GI149589008, Length=451, Percent_Identity=31.9290465631929, Blast_Score=203, Evalue=2e-52,
Organism=Homo sapiens, GI260593665, Length=303, Percent_Identity=37.6237623762376, Blast_Score=194, Evalue=1e-49,
Organism=Homo sapiens, GI260593663, Length=246, Percent_Identity=37.8048780487805, Blast_Score=154, Evalue=2e-37,
Organism=Escherichia coli, GI1789275, Length=441, Percent_Identity=49.6598639455782, Blast_Score=398, Evalue=1e-112,
Organism=Escherichia coli, GI1788728, Length=263, Percent_Identity=33.4600760456274, Blast_Score=117, Evalue=1e-27,
Organism=Escherichia coli, GI1790282, Length=296, Percent_Identity=28.0405405405405, Blast_Score=88, Evalue=1e-18,
Organism=Caenorhabditis elegans, GI17508215, Length=463, Percent_Identity=31.9654427645788, Blast_Score=206, Evalue=1e-53,
Organism=Caenorhabditis elegans, GI71989583, Length=279, Percent_Identity=32.9749103942652, Blast_Score=131, Evalue=7e-31,
Organism=Saccharomyces cerevisiae, GI6320922, Length=447, Percent_Identity=31.0961968680089, Blast_Score=219, Evalue=9e-58,
Organism=Saccharomyces cerevisiae, GI6321118, Length=453, Percent_Identity=28.6975717439294, Blast_Score=153, Evalue=4e-38,
Organism=Drosophila melanogaster, GI19920384, Length=406, Percent_Identity=37.192118226601, Blast_Score=226, Evalue=2e-59,
Organism=Drosophila melanogaster, GI21357079, Length=443, Percent_Identity=32.2799097065463, Blast_Score=187, Evalue=2e-47,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR000994
- InterPro:   IPR007865
- InterPro:   IPR001131 [H]

Pfam domain/function: PF05195 AMP_N; PF00557 Peptidase_M24 [H]

EC number: =3.4.11.9 [H]

Molecular weight: Translated: 49015; Mature: 48884

Theoretical pI: Translated: 4.66; Mature: 4.66

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.9 %Cys     (Translated Protein)
1.8 %Met     (Translated Protein)
2.7 %Cys+Met (Translated Protein)
0.9 %Cys     (Mature Protein)
1.6 %Met     (Mature Protein)
2.5 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MPRTPLPRPAAISPAEYRARRQSLMAALPPQSAVLLSAASLKTRNRDSEYPFRQDSDFHY
CCCCCCCCCCCCCHHHHHHHHHHHHHHCCCCCEEEEEHHHHHCCCCCCCCCCCCCCCCCE
LSGFPEPDALLVLLPGREDGEAVLFCQEKDPHMEAWTGLRIGAEKAVTTYGLDAAYENDE
ECCCCCCCEEEEEECCCCCCCEEEEECCCCCCHHHHCCCEECCCHHHEEECCCHHCCCCC
RDALLPELLDGRETLYLPFDDGETLALAESLRAELAAQARRGARAPRAFADVAPLIHERR
CCHHHHHHHCCCEEEEEECCCCCCHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHH
LIKSEAELDLMRHAARISAAAHRRAMRSVCPGLQEYQLQAELEHEFAWHGARAPAYATIV
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHCCCCCCEEEEEE
GGGENACVLHYIENGATLNDGDLVLIDAGGEFDLYAGDITRTFPVNGRFSSAQRELYDLV
ECCCCEEEEEEECCCCEECCCCEEEEECCCCEEEEECCEEEEECCCCCCCHHHHHHHHHH
LEAQCRAVAAVAPGTTLQAIHEGVVRDLTDGLIRLGLLEGPLETRIDDHGYRRFFLHATS
HHHHHHEEEEECCCCHHHHHHHHHHHHHHHHHHHHHHCCCCHHHCCCCCCCEEEEEEECC
HWLGLDVHDVGDYRLEGQPRELMPGMVLTVEPGLYIPDAEDIPEAYRGIGIRIEDDVAVT
CEEECEEECCCCEEECCCCHHHCCCEEEEECCCEECCCHHHHHHHHHCCCEEEECCEEEE
ATGREVLTTDVPKSVADIEALMHDR
ECCCEEEECCCCHHHHHHHHHHCCC
>Mature Secondary Structure 
PRTPLPRPAAISPAEYRARRQSLMAALPPQSAVLLSAASLKTRNRDSEYPFRQDSDFHY
CCCCCCCCCCCCHHHHHHHHHHHHHHCCCCCEEEEEHHHHHCCCCCCCCCCCCCCCCCE
LSGFPEPDALLVLLPGREDGEAVLFCQEKDPHMEAWTGLRIGAEKAVTTYGLDAAYENDE
ECCCCCCCEEEEEECCCCCCCEEEEECCCCCCHHHHCCCEECCCHHHEEECCCHHCCCCC
RDALLPELLDGRETLYLPFDDGETLALAESLRAELAAQARRGARAPRAFADVAPLIHERR
CCHHHHHHHCCCEEEEEECCCCCCHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHH
LIKSEAELDLMRHAARISAAAHRRAMRSVCPGLQEYQLQAELEHEFAWHGARAPAYATIV
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHCCCCCCEEEEEE
GGGENACVLHYIENGATLNDGDLVLIDAGGEFDLYAGDITRTFPVNGRFSSAQRELYDLV
ECCCCEEEEEEECCCCEECCCCEEEEECCCCEEEEECCEEEEECCCCCCCHHHHHHHHHH
LEAQCRAVAAVAPGTTLQAIHEGVVRDLTDGLIRLGLLEGPLETRIDDHGYRRFFLHATS
HHHHHHEEEEECCCCHHHHHHHHHHHHHHHHHHHHHHCCCCHHHCCCCCCCEEEEEEECC
HWLGLDVHDVGDYRLEGQPRELMPGMVLTVEPGLYIPDAEDIPEAYRGIGIRIEDDVAVT
CEEECEEECCCCEEECCCCHHHCCCEEEEECCCEECCCHHHHHHHHHCCCEEEECCEEEE
ATGREVLTTDVPKSVADIEALMHDR
ECCCEEEECCCCHHHHHHHHHHCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 7542800 [H]