| Definition | Burkholderia cenocepacia AU 1054 chromosome 1, complete sequence. |
|---|---|
| Accession | NC_008060 |
| Length | 3,294,563 |
Click here to switch to the map view.
The map label for this gene is pepP [H]
Identifier: 107021771
GI number: 107021771
Start: 224724
End: 226109
Strand: Reverse
Name: pepP [H]
Synonym: Bcen_0211
Alternate gene names: 107021771
Gene position: 226109-224724 (Counterclockwise)
Preceding gene: 107021773
Following gene: 107021770
Centisome position: 6.86
GC content: 71.14
Gene sequence:
>1386_bases ATGAATGCGCCCCTCGATACCGCCATCGCCGTCGACGTCTACCGCCAGCGCCGTGAACGCGTGCTTGCCGCACTGCGTGC CGCGGGCGGCGGCGTCGCCATCGTCCCCACCGCGCCGGAAATGCTGCGCAACCGCGATACGGCCTACCCGTACCGGTTCG ACAGCTACTTCCATTACCTGACGGGCTTCACCGAGCCGGATGCCGTGCTCGTGCTGAACGCGGCCGCGCCGCACGGCGCG CCGGAATCGATCCTGTTCTGCCGCGCCAGGAACGTCGACCGCGAGATCTGGGAAGGCTTTCACTACGGCCCCGACGCCGC GCGCGACGCGTTCGGCTTCGACGCGGCCTTCGCGACCGACGTGATCGACACCGAGATGCCGCGCCTGCTCGCCGATGCGG GCACCGTGCACTACCGGTTCGGCGCATCGGCCGACTTCGAGCGCCAGCTCGCCGGCTGGATCGACGCGGTGCGCGCGCAG GCACGCGCGGGCGTCGCCGCACCGGACGCGCTGCTCGACCTCACGCCGCTGCTCGACGACATGCGGCTCGTGAAGGACGA ACACGAACTCGCGATCATGATGCGCGCCGCGCACATCTCCGCGCTCGCGCACCGCCGCGCGATGCAGGTGTGCCGCCCGG GCATCCGCGAATACGAGCTCGAGGCCGAGCTGCTGTACCTGTTCCGCAAGCACGGCGCGCAGGCGCCCGCGTACGGCTCG ATCGTCGCGGCCGGCGCGAATGCGTGCGTGCTGCACTACCCGGCCGGCAACGCGGCCGCGCGGGACGGCGACCTGATCCT GATCGACGCCGCGTGCGAACTCGACGGCTATGCGTCGGACATCACGCGCACGTTCCCGGCCAACGGCCGCTTCTCGCCCG CGCAGCGCACGCTGTACGACATCGTGCTCGCCGCGCAGCAGGCTGCGATCGATGCGACGCGCGCGGGCGTGCCGTTCGAG GCACCGCACGACGCGGCCGTACGCGTGCTCGCGCAGGGGCTGCTCGACACCGGCATCATCCCGAAAACGCGCTTCTCGAA CGTCGACGACGTGATTGCCGAGCGCGCGTACACGCGCTTCTACATGCACCGCACGGGCCACTGGCTCGGAATGGACGTGC ACGACTGCGGCGACTACCGCGAACGGCTCGCCGCGCGCGACGCCAACGGCGCGCTGCCGTGGCGCACGCTGAAGCCCGGC ATGACGCTCACCGTCGAGCCCGGCCTGTACGTGCGCGCGGCCGACGACGTGCCGCCCGAGTACTGGAACATCGGCATCCG CATCGAGGACGACGCGATCGTACGCGAGCACGGCTGCGAGCTGATCACGCGCGGCGTGCCGGTCGCGGCCGACGAGATCG AGGCGCTGATGCGCGCGGACGCATGA
Upstream 100 bases:
>100_bases GGCCTGTGGATGGTTTGCAACAGCCGCCGCGCGGGACTTGGCCGGTGCGGCTTCGGGCCCTGCTCTCACGCACCGCGTCG CGCGGCGCTACAATCGCACG
Downstream 100 bases:
>100_bases CCGGGCGCCGACCGTTACCTCCGTTTCACGAATCAAGATGACGACCGCTTCCTCCCCGGCCACGCCGGATTACGATCTCG CCATCGTCGGCGCCGGCCCC
Product: peptidase M24
Products: NA
Alternate protein names: Aminoacylproline aminopeptidase; Aminopeptidase P II; APP-II; X-Pro aminopeptidase [H]
Number of amino acids: Translated: 461; Mature: 461
Protein sequence:
>461_residues MNAPLDTAIAVDVYRQRRERVLAALRAAGGGVAIVPTAPEMLRNRDTAYPYRFDSYFHYLTGFTEPDAVLVLNAAAPHGA PESILFCRARNVDREIWEGFHYGPDAARDAFGFDAAFATDVIDTEMPRLLADAGTVHYRFGASADFERQLAGWIDAVRAQ ARAGVAAPDALLDLTPLLDDMRLVKDEHELAIMMRAAHISALAHRRAMQVCRPGIREYELEAELLYLFRKHGAQAPAYGS IVAAGANACVLHYPAGNAAARDGDLILIDAACELDGYASDITRTFPANGRFSPAQRTLYDIVLAAQQAAIDATRAGVPFE APHDAAVRVLAQGLLDTGIIPKTRFSNVDDVIAERAYTRFYMHRTGHWLGMDVHDCGDYRERLAARDANGALPWRTLKPG MTLTVEPGLYVRAADDVPPEYWNIGIRIEDDAIVREHGCELITRGVPVAADEIEALMRADA
Sequences:
>Translated_461_residues MNAPLDTAIAVDVYRQRRERVLAALRAAGGGVAIVPTAPEMLRNRDTAYPYRFDSYFHYLTGFTEPDAVLVLNAAAPHGA PESILFCRARNVDREIWEGFHYGPDAARDAFGFDAAFATDVIDTEMPRLLADAGTVHYRFGASADFERQLAGWIDAVRAQ ARAGVAAPDALLDLTPLLDDMRLVKDEHELAIMMRAAHISALAHRRAMQVCRPGIREYELEAELLYLFRKHGAQAPAYGS IVAAGANACVLHYPAGNAAARDGDLILIDAACELDGYASDITRTFPANGRFSPAQRTLYDIVLAAQQAAIDATRAGVPFE APHDAAVRVLAQGLLDTGIIPKTRFSNVDDVIAERAYTRFYMHRTGHWLGMDVHDCGDYRERLAARDANGALPWRTLKPG MTLTVEPGLYVRAADDVPPEYWNIGIRIEDDAIVREHGCELITRGVPVAADEIEALMRADA >Mature_461_residues MNAPLDTAIAVDVYRQRRERVLAALRAAGGGVAIVPTAPEMLRNRDTAYPYRFDSYFHYLTGFTEPDAVLVLNAAAPHGA PESILFCRARNVDREIWEGFHYGPDAARDAFGFDAAFATDVIDTEMPRLLADAGTVHYRFGASADFERQLAGWIDAVRAQ ARAGVAAPDALLDLTPLLDDMRLVKDEHELAIMMRAAHISALAHRRAMQVCRPGIREYELEAELLYLFRKHGAQAPAYGS IVAAGANACVLHYPAGNAAARDGDLILIDAACELDGYASDITRTFPANGRFSPAQRTLYDIVLAAQQAAIDATRAGVPFE APHDAAVRVLAQGLLDTGIIPKTRFSNVDDVIAERAYTRFYMHRTGHWLGMDVHDCGDYRERLAARDANGALPWRTLKPG MTLTVEPGLYVRAADDVPPEYWNIGIRIEDDAIVREHGCELITRGVPVAADEIEALMRADA
Specific function: Unknown
COG id: COG0006
COG function: function code E; Xaa-Pro aminopeptidase
Gene ontology:
Cell location: Cytoplasm [H]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the peptidase M24B family [H]
Homologues:
Organism=Homo sapiens, GI11559925, Length=452, Percent_Identity=29.8672566371681, Blast_Score=217, Evalue=2e-56, Organism=Homo sapiens, GI149589008, Length=493, Percent_Identity=29.6146044624746, Blast_Score=178, Evalue=1e-44, Organism=Homo sapiens, GI260593665, Length=311, Percent_Identity=35.6913183279743, Blast_Score=164, Evalue=2e-40, Organism=Homo sapiens, GI260593663, Length=326, Percent_Identity=33.1288343558282, Blast_Score=138, Evalue=1e-32, Organism=Escherichia coli, GI1789275, Length=453, Percent_Identity=41.7218543046358, Blast_Score=357, Evalue=1e-100, Organism=Escherichia coli, GI1788728, Length=329, Percent_Identity=30.3951367781155, Blast_Score=123, Evalue=2e-29, Organism=Escherichia coli, GI1790282, Length=318, Percent_Identity=29.874213836478, Blast_Score=102, Evalue=5e-23, Organism=Caenorhabditis elegans, GI17508215, Length=479, Percent_Identity=30.8977035490605, Blast_Score=186, Evalue=3e-47, Organism=Caenorhabditis elegans, GI71989583, Length=378, Percent_Identity=27.7777777777778, Blast_Score=125, Evalue=6e-29, Organism=Saccharomyces cerevisiae, GI6320922, Length=421, Percent_Identity=27.0783847980998, Blast_Score=172, Evalue=9e-44, Organism=Saccharomyces cerevisiae, GI6321118, Length=438, Percent_Identity=28.7671232876712, Blast_Score=152, Evalue=1e-37, Organism=Drosophila melanogaster, GI19920384, Length=448, Percent_Identity=33.4821428571429, Blast_Score=204, Evalue=8e-53, Organism=Drosophila melanogaster, GI21357079, Length=500, Percent_Identity=30, Blast_Score=186, Evalue=3e-47,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR001714 - InterPro: IPR000994 - InterPro: IPR007865 - InterPro: IPR001131 [H]
Pfam domain/function: PF05195 AMP_N; PF00557 Peptidase_M24 [H]
EC number: =3.4.11.9 [H]
Molecular weight: Translated: 50526; Mature: 50526
Theoretical pI: Translated: 5.11; Mature: 5.11
Prosite motif: PS00491 PROLINE_PEPTIDASE
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.3 %Cys (Translated Protein) 2.4 %Met (Translated Protein) 3.7 %Cys+Met (Translated Protein) 1.3 %Cys (Mature Protein) 2.4 %Met (Mature Protein) 3.7 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MNAPLDTAIAVDVYRQRRERVLAALRAAGGGVAIVPTAPEMLRNRDTAYPYRFDSYFHYL CCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCEEEECCCHHHHCCCCCCCCEEHHHHHHHH TGFTEPDAVLVLNAAAPHGAPESILFCRARNVDREIWEGFHYGPDAARDAFGFDAAFATD CCCCCCCEEEEEECCCCCCCCCCEEEEECCCCCHHHHCCCCCCCCHHHHHCCCCHHHHHH VIDTEMPRLLADAGTVHYRFGASADFERQLAGWIDAVRAQARAGVAAPDALLDLTPLLDD HHHHHHHHHHHCCCCEEEEECCCCCHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHH MRLVKDEHELAIMMRAAHISALAHRRAMQVCRPGIREYELEAELLYLFRKHGAQAPAYGS HHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHCCCCCCCCC IVAAGANACVLHYPAGNAAARDGDLILIDAACELDGYASDITRTFPANGRFSPAQRTLYD EEECCCCEEEEECCCCCCCCCCCCEEEEEECCCCCCCHHHHHHCCCCCCCCCHHHHHHHH IVLAAQQAAIDATRAGVPFEAPHDAAVRVLAQGLLDTGIIPKTRFSNVDDVIAERAYTRF HHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHH YMHRTGHWLGMDVHDCGDYRERLAARDANGALPWRTLKPGMTLTVEPGLYVRAADDVPPE HHHHCCCEEECCHHHHHHHHHHHHHCCCCCCCCCEEECCCCEEEECCCEEEEECCCCCCC YWNIGIRIEDDAIVREHGCELITRGVPVAADEIEALMRADA CEEEEEEECCCHHHHHHCCHHHHCCCCCCHHHHHHHHHCCC >Mature Secondary Structure MNAPLDTAIAVDVYRQRRERVLAALRAAGGGVAIVPTAPEMLRNRDTAYPYRFDSYFHYL CCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCEEEECCCHHHHCCCCCCCCEEHHHHHHHH TGFTEPDAVLVLNAAAPHGAPESILFCRARNVDREIWEGFHYGPDAARDAFGFDAAFATD CCCCCCCEEEEEECCCCCCCCCCEEEEECCCCCHHHHCCCCCCCCHHHHHCCCCHHHHHH VIDTEMPRLLADAGTVHYRFGASADFERQLAGWIDAVRAQARAGVAAPDALLDLTPLLDD HHHHHHHHHHHCCCCEEEEECCCCCHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHH MRLVKDEHELAIMMRAAHISALAHRRAMQVCRPGIREYELEAELLYLFRKHGAQAPAYGS HHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHCCCCCCCCC IVAAGANACVLHYPAGNAAARDGDLILIDAACELDGYASDITRTFPANGRFSPAQRTLYD EEECCCCEEEEECCCCCCCCCCCCEEEEEECCCCCCCHHHHHHCCCCCCCCCHHHHHHHH IVLAAQQAAIDATRAGVPFEAPHDAAVRVLAQGLLDTGIIPKTRFSNVDDVIAERAYTRF HHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHH YMHRTGHWLGMDVHDCGDYRERLAARDANGALPWRTLKPGMTLTVEPGLYVRAADDVPPE HHHHCCCEEECCHHHHHHHHHHHHHCCCCCCCCCEEECCCCEEEECCCEEEEECCCCCCC YWNIGIRIEDDAIVREHGCELITRGVPVAADEIEALMRADA CEEEEEEECCCHHHHHHCCHHHHCCCCCCHHHHHHHHHCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 2659585; 1339425; 9278503; 9520390 [H]