| Definition | Ureaplasma urealyticum serovar 10 str. ATCC 33699 chromosome, complete genome. |
|---|---|
| Accession | NC_011374 |
| Length | 874,478 |
Click here to switch to the map view.
The map label for this gene is pepP [H]
Identifier: 209554182
GI number: 209554182
Start: 744255
End: 745328
Strand: Reverse
Name: pepP [H]
Synonym: UUR10_0624
Alternate gene names: 209554182
Gene position: 745328-744255 (Counterclockwise)
Preceding gene: 209554057
Following gene: 209554522
Centisome position: 85.23
GC content: 32.22
Gene sequence:
>1074_bases ATGAGTGATTTTAAGTTACAACAAGTTTTAAAAACAATTAAAGAACATGAAGCACAAGGCGTAGATGGCATGATTTTATT TTGCCCTTATAACCGTTATTGATTTTTAGAGTTTGCTTCAAGTGATGGTTTTGTATTTATTAACAAAGATGGTAAAGCAA TTTATCTAGTTGATGCTCGTTATTATACAGCAGCATCTGAAGCTGTAAAAAATGCTAAGGTAATTTTATTAGCTCGTACA CCACAAAAATCAACTTTTGATCTTTTAAAAGATGCAATGGTTGAATTAAATATTACTAATGCACTAGTAGAAGCAGATTA TGTAACATTAAACGTACATGAAATGTTACAAAAATTAGTTAGAAAAACTACTCTTTTTACATCGGCTGCATTACGTGCTA TTAAAACAGAAAAAGAACTTGAATATTTACAAAAAGCCGCTGATATTGCTGCTTTAACATGTAATTGAATTCGAGAACAA GATATTATTGGTCGAACAGAACTTGAAGTTGCAATGCTAGTTTCAAAACACATGTTAGAATTAGGTGGCGAACTAAATTC ATTTGATCCGATTATTGCCTCAGGACCAAATGGAGGTTCACCACACCACCATCCAGGCAATCGTGTAATTGAAGATGGTG ATATGGTAACAGTTGACATTGGTTGCACTTACAAAGGTTATTGTTCTGATATTACAAGATCTTTCATTGTTGGTAATAAA GCAAATCCCCAAATGCAAGAAATTTATGATAAAGTACTTGAATCGCAAACAGCTGGAATTGATTTAGTAAGCACAAAAGT AACTGGTCAAGAAGTTGATAAGTTATGTCGTGATATTATTGATAATTCTAAATTTAACGGCTATTTCACACATGGAACAG GACATGGTGTTGGATTAGAAGTTCATGAATTACCAAATACTAATGCTGGTAACCCTAATAAATTACCATTAAATGCTGTT GTTACTGTTGAACCAGGGATTTACATTCCAAATGTTGGTGGCGTAAGAATTGAAGATACAGTTGTAGTAAAAGATGGTCA AGCTTTAGTTTTAACAAGATTAGCTTATAAATAA
Upstream 100 bases:
>100_bases GCAAAAAATAATCCAGACAAACTTTCTTTAAACAAATTTTGTCCTAAATGTCGTAAAGTAACAACTCACGTTGAAATTAA GAAGAAATAGGTATTAGATT
Downstream 100 bases:
>100_bases AATTTAATAAAAAAGGGTATAGTTCAATTGGTAGAACAGCAGACTCCAAATCTGCGTGTTGCGGGTTCGAGTCCTGTTAC CCTTGCCATTAAAAATAAAA
Product: peptidase/creatianse family protein
Products: NA
Alternate protein names: X-Pro aminopeptidase; Aminoacylproline aminopeptidase; Aminopeptidase P; APP [H]
Number of amino acids: Translated: 357; Mature: 356
Protein sequence:
>357_residues MSDFKLQQVLKTIKEHEAQGVDGMILFCPYNRYWFLEFASSDGFVFINKDGKAIYLVDARYYTAASEAVKNAKVILLART PQKSTFDLLKDAMVELNITNALVEADYVTLNVHEMLQKLVRKTTLFTSAALRAIKTEKELEYLQKAADIAALTCNWIREQ DIIGRTELEVAMLVSKHMLELGGELNSFDPIIASGPNGGSPHHHPGNRVIEDGDMVTVDIGCTYKGYCSDITRSFIVGNK ANPQMQEIYDKVLESQTAGIDLVSTKVTGQEVDKLCRDIIDNSKFNGYFTHGTGHGVGLEVHELPNTNAGNPNKLPLNAV VTVEPGIYIPNVGGVRIEDTVVVKDGQALVLTRLAYK
Sequences:
>Translated_357_residues MSDFKLQQVLKTIKEHEAQGVDGMILFCPYNRY*FLEFASSDGFVFINKDGKAIYLVDARYYTAASEAVKNAKVILLART PQKSTFDLLKDAMVELNITNALVEADYVTLNVHEMLQKLVRKTTLFTSAALRAIKTEKELEYLQKAADIAALTCN*IREQ DIIGRTELEVAMLVSKHMLELGGELNSFDPIIASGPNGGSPHHHPGNRVIEDGDMVTVDIGCTYKGYCSDITRSFIVGNK ANPQMQEIYDKVLESQTAGIDLVSTKVTGQEVDKLCRDIIDNSKFNGYFTHGTGHGVGLEVHELPNTNAGNPNKLPLNAV VTVEPGIYIPNVGGVRIEDTVVVKDGQALVLTRLAYK >Mature_356_residues SDFKLQQVLKTIKEHEAQGVDGMILFCPYNRY*FLEFASSDGFVFINKDGKAIYLVDARYYTAASEAVKNAKVILLARTP QKSTFDLLKDAMVELNITNALVEADYVTLNVHEMLQKLVRKTTLFTSAALRAIKTEKELEYLQKAADIAALTCN*IREQD IIGRTELEVAMLVSKHMLELGGELNSFDPIIASGPNGGSPHHHPGNRVIEDGDMVTVDIGCTYKGYCSDITRSFIVGNKA NPQMQEIYDKVLESQTAGIDLVSTKVTGQEVDKLCRDIIDNSKFNGYFTHGTGHGVGLEVHELPNTNAGNPNKLPLNAVV TVEPGIYIPNVGGVRIEDTVVVKDGQALVLTRLAYK
Specific function: Unknown
COG id: COG0006
COG function: function code E; Xaa-Pro aminopeptidase
Gene ontology:
Cell location: Cytoplasmic
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the peptidase M24B family [H]
Homologues:
Organism=Homo sapiens, GI11559925, Length=300, Percent_Identity=30, Blast_Score=114, Evalue=9e-26, Organism=Homo sapiens, GI264681563, Length=279, Percent_Identity=29.3906810035842, Blast_Score=80, Evalue=2e-15, Organism=Homo sapiens, GI93141226, Length=263, Percent_Identity=28.5171102661597, Blast_Score=75, Evalue=1e-13, Organism=Homo sapiens, GI149589008, Length=283, Percent_Identity=26.1484098939929, Blast_Score=74, Evalue=3e-13, Organism=Homo sapiens, GI260593665, Length=283, Percent_Identity=26.1484098939929, Blast_Score=73, Evalue=3e-13, Organism=Escherichia coli, GI1788728, Length=340, Percent_Identity=34.1176470588235, Blast_Score=176, Evalue=2e-45, Organism=Escherichia coli, GI1789275, Length=242, Percent_Identity=30.5785123966942, Blast_Score=105, Evalue=7e-24, Organism=Caenorhabditis elegans, GI17509539, Length=239, Percent_Identity=30.1255230125523, Blast_Score=76, Evalue=3e-14, Organism=Caenorhabditis elegans, GI17508215, Length=279, Percent_Identity=25.8064516129032, Blast_Score=71, Evalue=8e-13, Organism=Saccharomyces cerevisiae, GI6320922, Length=251, Percent_Identity=27.4900398406374, Blast_Score=99, Evalue=1e-21, Organism=Saccharomyces cerevisiae, GI6321118, Length=278, Percent_Identity=26.978417266187, Blast_Score=90, Evalue=5e-19, Organism=Saccharomyces cerevisiae, GI6322999, Length=233, Percent_Identity=27.0386266094421, Blast_Score=64, Evalue=4e-11, Organism=Drosophila melanogaster, GI21357079, Length=391, Percent_Identity=25.0639386189258, Blast_Score=79, Evalue=3e-15, Organism=Drosophila melanogaster, GI19920384, Length=261, Percent_Identity=26.0536398467433, Blast_Score=77, Evalue=2e-14, Organism=Drosophila melanogaster, GI17137632, Length=170, Percent_Identity=34.7058823529412, Blast_Score=73, Evalue=4e-13,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR000587 - InterPro: IPR000994 - InterPro: IPR001131 [H]
Pfam domain/function: PF01321 Creatinase_N; PF00557 Peptidase_M24 [H]
EC number: =3.4.11.9 [H]
Molecular weight: Translated: 39034; Mature: 38903
Theoretical pI: Translated: 5.63; Mature: 5.63
Prosite motif: PS00491 PROLINE_PEPTIDASE
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.4 %Cys (Translated Protein) 2.2 %Met (Translated Protein) 3.6 %Cys+Met (Translated Protein) 1.4 %Cys (Mature Protein) 2.0 %Met (Mature Protein) 3.4 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MSDFKLQQVLKTIKEHEAQGVDGMILFCPYNRYFLEFASSDGFVFINKDGKAIYLVDARY CCCHHHHHHHHHHHHHHCCCCCCEEEEECCCEEEEEEECCCCEEEEECCCCEEEEEECCH YTAASEAVKNAKVILLARTPQKSTFDLLKDAMVELNITNALVEADYVTLNVHEMLQKLVR HHHHHHHHCCCEEEEEEECCCCHHHHHHHHHHEEEEEHHHEEEEEEEEEEHHHHHHHHHH KTTLFTSAALRAIKTEKELEYLQKAADIAALTCNIREQDIIGRTELEVAMLVSKHMLELG HHHHHHHHHHHHHHHHHHHHHHHHHHCEEEEEECCCHHCCCCCHHHHHHHHHHHHHHHHC GELNSFDPIIASGPNGGSPHHHPGNRVIEDGDMVTVDIGCTYKGYCSDITRSFIVGNKAN CCCCCCCCEEECCCCCCCCCCCCCCCEEECCCEEEEEECCCCCHHHHHHHHHHHCCCCCC PQMQEIYDKVLESQTAGIDLVSTKVTGQEVDKLCRDIIDNSKFNGYFTHGTGHGVGLEVH CHHHHHHHHHHHCCCCCCEEEEEECCHHHHHHHHHHHHCCCCCCEEEECCCCCCCCEEEE ELPNTNAGNPNKLPLNAVVTVEPGIYIPNVGGVRIEDTVVVKDGQALVLTRLAYK ECCCCCCCCCCCCCEEEEEEECCCEEECCCCCEEEEEEEEEECCCEEEEEEECCC >Mature Secondary Structure SDFKLQQVLKTIKEHEAQGVDGMILFCPYNRYFLEFASSDGFVFINKDGKAIYLVDARY CCHHHHHHHHHHHHHHCCCCCCEEEEECCCEEEEEEECCCCEEEEECCCCEEEEEECCH YTAASEAVKNAKVILLARTPQKSTFDLLKDAMVELNITNALVEADYVTLNVHEMLQKLVR HHHHHHHHCCCEEEEEEECCCCHHHHHHHHHHEEEEEHHHEEEEEEEEEEHHHHHHHHHH KTTLFTSAALRAIKTEKELEYLQKAADIAALTCNIREQDIIGRTELEVAMLVSKHMLELG HHHHHHHHHHHHHHHHHHHHHHHHHHCEEEEEECCCHHCCCCCHHHHHHHHHHHHHHHHC GELNSFDPIIASGPNGGSPHHHPGNRVIEDGDMVTVDIGCTYKGYCSDITRSFIVGNKAN CCCCCCCCEEECCCCCCCCCCCCCCCEEECCCEEEEEECCCCCHHHHHHHHHHHCCCCCC PQMQEIYDKVLESQTAGIDLVSTKVTGQEVDKLCRDIIDNSKFNGYFTHGTGHGVGLEVH CHHHHHHHHHHHCCCCCCEEEEEECCHHHHHHHHHHHHCCCCCCEEEECCCCCCCCEEEE ELPNTNAGNPNKLPLNAVVTVEPGIYIPNVGGVRIEDTVVVKDGQALVLTRLAYK ECCCCCCCCCCCCCEEEEEEECCCEEECCCCCEEEEEEEEEECCCEEEEEEECCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 10.0
TargetDB status: NA
Availability: NA
References: 7569993; 8253680 [H]