| Definition | Parabacteroides distasonis ATCC 8503 chromosome, complete genome. |
|---|---|
| Accession | NC_009615 |
| Length | 4,811,379 |
Click here to switch to the map view.
The map label for this gene is ptpA [H]
Identifier: 150009679
GI number: 150009679
Start: 3709766
End: 3711967
Strand: Direct
Name: ptpA [H]
Synonym: BDI_3094
Alternate gene names: 150009679
Gene position: 3709766-3711967 (Clockwise)
Preceding gene: 150009678
Following gene: 150009680
Centisome position: 77.1
GC content: 47.59
Gene sequence:
>2202_bases ATGATGATTATGAGGATTAAATCATCTTTATTCATAAGCCTATGTCTGATTTTATTAACGATGTCGATTACCGCCCAAGA TAAGCAACTCTCCTTGCACGACTTGATTCCGGGAGGAAAAACGTATAGCCGCTTCGTACCTCGTGACTTGAAACAGTTAC GATGGTGCGGGGACGAGTACTTATATGTTAAGGGAGATAGCGTGTTAGGAGCTAAGCCGGGGAAAAAAGAAGAGGTCCTT TTTTCGTTGGAAAGACTGAATGGGGCCTTGACGGTGGCAAACCTACAGACGGTTGGTTCCTTGCCTAGCTTTTCGGTACC CTATGAAAGTGGTTCGGTCTTGGCTTTTACTAGCAAACAGCACCGGATTCATTATGACTATAAGAAGAATAAGGTAGTCG CTGATTATGCTTTGAAGAATAACTGGGCGAATTATGACTTTTGTCCGGCTACGAATAACTTAGCTTTTACGGAGGGAAAC AATGTGCATATTTTATCCCCGGATGGACGAAATACGATTGTTACACGTGAAACACAGGATGGAATCGTATGCGGACAGGC TGTCCATCAACGGGAGTTCGGGATTACGAAAGGTATGTTTTGGTCTCCTAAAGGTTCGGCTCTAGCGTTTTATCGTATGG ATGAGCGTATGGTGACCGCTTACCCGCTGGTGAATATCGATACTCGTTGCGCTACGCCGGTTCCTCATAAATATCCGATG GCTGGAATGAAGAGCCATGAGGTTACGGTGGGTGTCTATCAGGTAGCTACCGGGCAGACGGTTTGGTTGGAGACAGGCTT GCCGAAAGAGAAATATTTAACAAATATCGCTTGGAGTCCGGATGAGAAGAGTATTTATATCGCTGAGTTGAATCGTGAGC AGAACGAGATGCATTTGGTGCGGTACTCTGCCTTGACGGGAAAGAAAGAGGCTGATCTGTTTACCGAGACGGATCGTTGT TATGTGGAGCCGCAGCATCCCGTGCTTTTCTTGCCGAACGATCCGGATAAGTTTATCTGGCAGAGTGAGGCGGATGGCTA TAACCATCTATATCTGTATGATACGACTGGAAAGGAATTAAGGAAGCTAACCGGTGGGGAATGGGTGGTTACCAAGGTGC TAGGCTTTAGCAAAGACGGAAATAAGGTGATTTTCGAGGGAACGGCACCTCATCCCGTATCTCCGAATATGCAAGGAACG GGGATGCAACGTTATATTTGGGAGACGGATTTGAGAACGGGTGATATCATGAATTGCTTGAGTTGGAAAGTGGGCGTGCA CCGTTGGTTGCTGAGTCCCTCCGGCGAATATGCGATTGATTATGTAAGTTCTCCTTCTACCCCGAGGGATATCGATTTAA TCCGTGTAAAGGACGCTAAGGTGATTTCTACCTTACTTTCCGCTCCGGATCCTTTTAAATCGTATCGGATGCCGCAGATC AAGGTTGGATATATCCTTGCTGCCGATGGTAAGACTCGCTTGAATTACCGGTTGACTTTACCGCCGGATTTGGATGAGAC GAAGAAGTATCCTACGATTGTCTACGTCTATGGAGGCCCGCATGCCCAATTGGTTACGGGCGACTGGCAAAACGGGGCTC GTGGCTGGGATCTCTATATGGCACAAAGAGGTTATGTGATGTTTTCCGTGGATAGCCGTGGCTCGGCGAACCGCGGGCAT GCTTTTGAGAGCGTGATTCATCGTAATTTGGGTATCAACGAGATGGCGGATCAAGTGAAGGGGGTCGAGTTCTTGAAATC CTTGCCTTATGTGGATGCCGACCGTATCGGGGTACATGGCTGGAGTTATGGCGGTTTTATGACAACGAACTTGATGCTGA CGTATCCGGAGATCTTTAAGGTGGGCGTGGCCGGAGGGCCGGTTATCGACTGGAGCAATTACGAGATCATGTATGGCGAG CGTTATATGGATCGCCCGCAGGATAATCCGGAAGGTTATAAGAACGCGAACCTGAAACTGAAGGCCGGCAATCTGAAAGG CCATCTGCTGATGATACATGGGGATATCGATCCGGTGGTAGTGTGGCAACACAGCCTAGGTTTCTTGAAGGCTTGCGTAG AGGCTGATACGTATCCGGATTACTTTGTTTATCCTCGTCATGAGCATAACGTGACCGGTAAGGACCGTCCGCATTTGCAT GAGAAGATTACGAGGTATTTCGATGATTACTTGAAAAATTGA
Upstream 100 bases:
>100_bases TATCGGGATGAGGATGACCGTAAGAAAGGGTTTGGCGATCATAAGCGGGATGGAAAGCGCCCGTTTAGCAAACCTATAAA GCCTATAAAACGGAGAGGGT
Downstream 100 bases:
>100_bases GAATTGAAAATTAGAAGAGATATGAATATATTGTTATTAGGCTCTGGTGGGCGTGAGCATGCGATCGCTTGGAAGATCGC TCAAAGCCCGAAAGTTGATA
Product: dipeptidyl peptidase IV
Products: NA
Alternate protein names: PTP; Prolyl tripeptidyl peptidase A [H]
Number of amino acids: Translated: 733; Mature: 733
Protein sequence:
>733_residues MMIMRIKSSLFISLCLILLTMSITAQDKQLSLHDLIPGGKTYSRFVPRDLKQLRWCGDEYLYVKGDSVLGAKPGKKEEVL FSLERLNGALTVANLQTVGSLPSFSVPYESGSVLAFTSKQHRIHYDYKKNKVVADYALKNNWANYDFCPATNNLAFTEGN NVHILSPDGRNTIVTRETQDGIVCGQAVHQREFGITKGMFWSPKGSALAFYRMDERMVTAYPLVNIDTRCATPVPHKYPM AGMKSHEVTVGVYQVATGQTVWLETGLPKEKYLTNIAWSPDEKSIYIAELNREQNEMHLVRYSALTGKKEADLFTETDRC YVEPQHPVLFLPNDPDKFIWQSEADGYNHLYLYDTTGKELRKLTGGEWVVTKVLGFSKDGNKVIFEGTAPHPVSPNMQGT GMQRYIWETDLRTGDIMNCLSWKVGVHRWLLSPSGEYAIDYVSSPSTPRDIDLIRVKDAKVISTLLSAPDPFKSYRMPQI KVGYILAADGKTRLNYRLTLPPDLDETKKYPTIVYVYGGPHAQLVTGDWQNGARGWDLYMAQRGYVMFSVDSRGSANRGH AFESVIHRNLGINEMADQVKGVEFLKSLPYVDADRIGVHGWSYGGFMTTNLMLTYPEIFKVGVAGGPVIDWSNYEIMYGE RYMDRPQDNPEGYKNANLKLKAGNLKGHLLMIHGDIDPVVVWQHSLGFLKACVEADTYPDYFVYPRHEHNVTGKDRPHLH EKITRYFDDYLKN
Sequences:
>Translated_733_residues MMIMRIKSSLFISLCLILLTMSITAQDKQLSLHDLIPGGKTYSRFVPRDLKQLRWCGDEYLYVKGDSVLGAKPGKKEEVL FSLERLNGALTVANLQTVGSLPSFSVPYESGSVLAFTSKQHRIHYDYKKNKVVADYALKNNWANYDFCPATNNLAFTEGN NVHILSPDGRNTIVTRETQDGIVCGQAVHQREFGITKGMFWSPKGSALAFYRMDERMVTAYPLVNIDTRCATPVPHKYPM AGMKSHEVTVGVYQVATGQTVWLETGLPKEKYLTNIAWSPDEKSIYIAELNREQNEMHLVRYSALTGKKEADLFTETDRC YVEPQHPVLFLPNDPDKFIWQSEADGYNHLYLYDTTGKELRKLTGGEWVVTKVLGFSKDGNKVIFEGTAPHPVSPNMQGT GMQRYIWETDLRTGDIMNCLSWKVGVHRWLLSPSGEYAIDYVSSPSTPRDIDLIRVKDAKVISTLLSAPDPFKSYRMPQI KVGYILAADGKTRLNYRLTLPPDLDETKKYPTIVYVYGGPHAQLVTGDWQNGARGWDLYMAQRGYVMFSVDSRGSANRGH AFESVIHRNLGINEMADQVKGVEFLKSLPYVDADRIGVHGWSYGGFMTTNLMLTYPEIFKVGVAGGPVIDWSNYEIMYGE RYMDRPQDNPEGYKNANLKLKAGNLKGHLLMIHGDIDPVVVWQHSLGFLKACVEADTYPDYFVYPRHEHNVTGKDRPHLH EKITRYFDDYLKN >Mature_733_residues MMIMRIKSSLFISLCLILLTMSITAQDKQLSLHDLIPGGKTYSRFVPRDLKQLRWCGDEYLYVKGDSVLGAKPGKKEEVL FSLERLNGALTVANLQTVGSLPSFSVPYESGSVLAFTSKQHRIHYDYKKNKVVADYALKNNWANYDFCPATNNLAFTEGN NVHILSPDGRNTIVTRETQDGIVCGQAVHQREFGITKGMFWSPKGSALAFYRMDERMVTAYPLVNIDTRCATPVPHKYPM AGMKSHEVTVGVYQVATGQTVWLETGLPKEKYLTNIAWSPDEKSIYIAELNREQNEMHLVRYSALTGKKEADLFTETDRC YVEPQHPVLFLPNDPDKFIWQSEADGYNHLYLYDTTGKELRKLTGGEWVVTKVLGFSKDGNKVIFEGTAPHPVSPNMQGT GMQRYIWETDLRTGDIMNCLSWKVGVHRWLLSPSGEYAIDYVSSPSTPRDIDLIRVKDAKVISTLLSAPDPFKSYRMPQI KVGYILAADGKTRLNYRLTLPPDLDETKKYPTIVYVYGGPHAQLVTGDWQNGARGWDLYMAQRGYVMFSVDSRGSANRGH AFESVIHRNLGINEMADQVKGVEFLKSLPYVDADRIGVHGWSYGGFMTTNLMLTYPEIFKVGVAGGPVIDWSNYEIMYGE RYMDRPQDNPEGYKNANLKLKAGNLKGHLLMIHGDIDPVVVWQHSLGFLKACVEADTYPDYFVYPRHEHNVTGKDRPHLH EKITRYFDDYLKN
Specific function: Serine proteinase. Releases tripeptides from the free amino terminus of proteins. Has a requirement for Pro in the P1 position, but is inactivated by Pro in the P1' position [H]
COG id: COG1506
COG function: function code E; Dipeptidyl aminopeptidases/acylaminoacyl-peptidases
Gene ontology:
Cell location: Cytoplasmic
Metaboloic importance: NA
Operon status: Not Known
Operon components: None
Similarity: Belongs to the peptidase S9B family [H]
Homologues:
Organism=Homo sapiens, GI37577089, Length=669, Percent_Identity=26.0089686098655, Blast_Score=179, Evalue=8e-45, Organism=Homo sapiens, GI18450280, Length=669, Percent_Identity=26.0089686098655, Blast_Score=179, Evalue=1e-44, Organism=Homo sapiens, GI18765694, Length=746, Percent_Identity=24.9329758713137, Blast_Score=177, Evalue=3e-44, Organism=Homo sapiens, GI295842403, Length=594, Percent_Identity=25.7575757575758, Blast_Score=170, Evalue=4e-42, Organism=Homo sapiens, GI85787627, Length=594, Percent_Identity=25.7575757575758, Blast_Score=170, Evalue=5e-42, Organism=Homo sapiens, GI52426756, Length=594, Percent_Identity=25.7575757575758, Blast_Score=170, Evalue=5e-42, Organism=Homo sapiens, GI295849272, Length=594, Percent_Identity=25.7575757575758, Blast_Score=169, Evalue=6e-42, Organism=Homo sapiens, GI295842359, Length=594, Percent_Identity=25.7575757575758, Blast_Score=169, Evalue=7e-42, Organism=Homo sapiens, GI16933540, Length=766, Percent_Identity=23.8903394255875, Blast_Score=160, Evalue=3e-39, Organism=Homo sapiens, GI194394146, Length=393, Percent_Identity=28.498727735369, Blast_Score=159, Evalue=9e-39, Organism=Homo sapiens, GI86792778, Length=619, Percent_Identity=23.5864297253635, Blast_Score=137, Evalue=3e-32, Organism=Homo sapiens, GI86792774, Length=619, Percent_Identity=23.5864297253635, Blast_Score=137, Evalue=4e-32, Organism=Homo sapiens, GI86792863, Length=619, Percent_Identity=23.5864297253635, Blast_Score=137, Evalue=4e-32, Organism=Homo sapiens, GI37577091, Length=668, Percent_Identity=22.9041916167665, Blast_Score=108, Evalue=2e-23, Organism=Caenorhabditis elegans, GI17508017, Length=229, Percent_Identity=34.9344978165939, Blast_Score=146, Evalue=4e-35, Organism=Caenorhabditis elegans, GI17508019, Length=229, Percent_Identity=34.9344978165939, Blast_Score=146, Evalue=4e-35, Organism=Caenorhabditis elegans, GI17564634, Length=618, Percent_Identity=25.2427184466019, Blast_Score=135, Evalue=6e-32, Organism=Caenorhabditis elegans, GI17564632, Length=618, Percent_Identity=25.0809061488673, Blast_Score=135, Evalue=7e-32, Organism=Caenorhabditis elegans, GI17550672, Length=573, Percent_Identity=23.9092495636998, Blast_Score=122, Evalue=6e-28, Organism=Saccharomyces cerevisiae, GI6321817, Length=614, Percent_Identity=26.2214983713355, Blast_Score=163, Evalue=8e-41, Organism=Saccharomyces cerevisiae, GI6324793, Length=619, Percent_Identity=24.3941841680129, Blast_Score=147, Evalue=7e-36, Organism=Drosophila melanogaster, GI45551969, Length=642, Percent_Identity=23.8317757009346, Blast_Score=172, Evalue=9e-43, Organism=Drosophila melanogaster, GI45550825, Length=642, Percent_Identity=23.8317757009346, Blast_Score=172, Evalue=1e-42, Organism=Drosophila melanogaster, GI45553511, Length=642, Percent_Identity=23.8317757009346, Blast_Score=172, Evalue=1e-42, Organism=Drosophila melanogaster, GI17933704, Length=641, Percent_Identity=26.8330733229329, Blast_Score=156, Evalue=5e-38, Organism=Drosophila melanogaster, GI161083744, Length=641, Percent_Identity=26.8330733229329, Blast_Score=155, Evalue=7e-38, Organism=Drosophila melanogaster, GI221331178, Length=641, Percent_Identity=26.8330733229329, Blast_Score=155, Evalue=7e-38, Organism=Drosophila melanogaster, GI24582257, Length=263, Percent_Identity=34.6007604562738, Blast_Score=155, Evalue=7e-38, Organism=Drosophila melanogaster, GI24582032, Length=615, Percent_Identity=26.0162601626016, Blast_Score=152, Evalue=6e-37, Organism=Drosophila melanogaster, GI45551475, Length=239, Percent_Identity=30.1255230125523, Blast_Score=127, Evalue=3e-29, Organism=Drosophila melanogaster, GI221372263, Length=239, Percent_Identity=30.1255230125523, Blast_Score=127, Evalue=3e-29, Organism=Drosophila melanogaster, GI221372266, Length=239, Percent_Identity=30.1255230125523, Blast_Score=127, Evalue=3e-29,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR001375 - InterPro: IPR002469 [H]
Pfam domain/function: PF00930 DPPIV_N; PF00326 Peptidase_S9 [H]
EC number: =3.4.14.12 [H]
Molecular weight: Translated: 83075; Mature: 83075
Theoretical pI: Translated: 7.69; Mature: 7.69
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.1 %Cys (Translated Protein) 3.0 %Met (Translated Protein) 4.1 %Cys+Met (Translated Protein) 1.1 %Cys (Mature Protein) 3.0 %Met (Mature Protein) 4.1 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MMIMRIKSSLFISLCLILLTMSITAQDKQLSLHDLIPGGKTYSRFVPRDLKQLRWCGDEY CEEEEEHHHHHHHHHHHHHHHHCCCCCCCEEHHHCCCCCCHHHHHCHHHHHHHHHCCCCE LYVKGDSVLGAKPGKKEEVLFSLERLNGALTVANLQTVGSLPSFSVPYESGSVLAFTSKQ EEEECCEEECCCCCCHHHHHHHHHHCCCEEEEEEEHHHCCCCCCCCCCCCCCEEEEECCC HRIHYDYKKNKVVADYALKNNWANYDFCPATNNLAFTEGNNVHILSPDGRNTIVTRETQD CEEEEEECCCEEEEEEHHHCCCCCCEECCCCCCEEEECCCEEEEECCCCCCEEEEECCCC GIVCGQAVHQREFGITKGMFWSPKGSALAFYRMDERMVTAYPLVNIDTRCATPVPHKYPM CEEECHHHHHHHCCCCCCEEECCCCCEEEEEEECCEEEEEEEEEECCCCCCCCCCCCCCC AGMKSHEVTVGVYQVATGQTVWLETGLPKEKYLTNIAWSPDEKSIYIAELNREQNEMHLV CCCCCCEEEEEEEEEECCCEEEEECCCCHHHHHEECCCCCCCCEEEEEECCCCCCCEEEE RYSALTGKKEADLFTETDRCYVEPQHPVLFLPNDPDKFIWQSEADGYNHLYLYDTTGKEL EEEECCCCCCCCEEECCCEEEECCCCCEEEECCCCCCEEEECCCCCCEEEEEEECCCHHH RKLTGGEWVVTKVLGFSKDGNKVIFEGTAPHPVSPNMQGTGMQRYIWETDLRTGDIMNCL HHHCCCCEEEEEEECCCCCCCEEEEECCCCCCCCCCCCCCCCEEEEEECCCCCCHHHHHH SWKVGVHRWLLSPSGEYAIDYVSSPSTPRDIDLIRVKDAKVISTLLSAPDPFKSYRMPQI HHHHCCEEEEECCCCCEEEEEECCCCCCCCEEEEEECCHHHHHHHHCCCCCHHHCCCCEE KVGYILAADGKTRLNYRLTLPPDLDETKKYPTIVYVYGGPHAQLVTGDWQNGARGWDLYM EEEEEEEECCCEEEEEEEECCCCCCHHCCCCEEEEEECCCCEEEEECCCCCCCCCEEEEE AQRGYVMFSVDSRGSANRGHAFESVIHRNLGINEMADQVKGVEFLKSLPYVDADRIGVHG EECCEEEEEECCCCCCCCCHHHHHHHHHCCCHHHHHHHHHHHHHHHHCCCCCCCCEEECE WSYGGFMTTNLMLTYPEIFKVGVAGGPVIDWSNYEIMYGERYMDRPQDNPEGYKNANLKL ECCCCEEEEEEEEECHHHEEEECCCCCEEECCCEEEEECCHHCCCCCCCCCCCCCCCEEE KAGNLKGHLLMIHGDIDPVVVWQHSLGFLKACVEADTYPDYFVYPRHEHNVTGKDRPHLH EECCCCEEEEEEECCCCEEEEEEHHHHHHHHHHHCCCCCCEEEECCCCCCCCCCCCCHHH EKITRYFDDYLKN HHHHHHHHHHHCC >Mature Secondary Structure MMIMRIKSSLFISLCLILLTMSITAQDKQLSLHDLIPGGKTYSRFVPRDLKQLRWCGDEY CEEEEEHHHHHHHHHHHHHHHHCCCCCCCEEHHHCCCCCCHHHHHCHHHHHHHHHCCCCE LYVKGDSVLGAKPGKKEEVLFSLERLNGALTVANLQTVGSLPSFSVPYESGSVLAFTSKQ EEEECCEEECCCCCCHHHHHHHHHHCCCEEEEEEEHHHCCCCCCCCCCCCCCEEEEECCC HRIHYDYKKNKVVADYALKNNWANYDFCPATNNLAFTEGNNVHILSPDGRNTIVTRETQD CEEEEEECCCEEEEEEHHHCCCCCCEECCCCCCEEEECCCEEEEECCCCCCEEEEECCCC GIVCGQAVHQREFGITKGMFWSPKGSALAFYRMDERMVTAYPLVNIDTRCATPVPHKYPM CEEECHHHHHHHCCCCCCEEECCCCCEEEEEEECCEEEEEEEEEECCCCCCCCCCCCCCC AGMKSHEVTVGVYQVATGQTVWLETGLPKEKYLTNIAWSPDEKSIYIAELNREQNEMHLV CCCCCCEEEEEEEEEECCCEEEEECCCCHHHHHEECCCCCCCCEEEEEECCCCCCCEEEE RYSALTGKKEADLFTETDRCYVEPQHPVLFLPNDPDKFIWQSEADGYNHLYLYDTTGKEL EEEECCCCCCCCEEECCCEEEECCCCCEEEECCCCCCEEEECCCCCCEEEEEEECCCHHH RKLTGGEWVVTKVLGFSKDGNKVIFEGTAPHPVSPNMQGTGMQRYIWETDLRTGDIMNCL HHHCCCCEEEEEEECCCCCCCEEEEECCCCCCCCCCCCCCCCEEEEEECCCCCCHHHHHH SWKVGVHRWLLSPSGEYAIDYVSSPSTPRDIDLIRVKDAKVISTLLSAPDPFKSYRMPQI HHHHCCEEEEECCCCCEEEEEECCCCCCCCEEEEEECCHHHHHHHHCCCCCHHHCCCCEE KVGYILAADGKTRLNYRLTLPPDLDETKKYPTIVYVYGGPHAQLVTGDWQNGARGWDLYM EEEEEEEECCCEEEEEEEECCCCCCHHCCCCEEEEEECCCCEEEEECCCCCCCCCEEEEE AQRGYVMFSVDSRGSANRGHAFESVIHRNLGINEMADQVKGVEFLKSLPYVDADRIGVHG EECCEEEEEECCCCCCCCCHHHHHHHHHCCCHHHHHHHHHHHHHHHHCCCCCCCCEEECE WSYGGFMTTNLMLTYPEIFKVGVAGGPVIDWSNYEIMYGERYMDRPQDNPEGYKNANLKL ECCCCEEEEEEEEECHHHEEEECCCCCEEECCCEEEEECCHHCCCCCCCCCCCCCCCEEE KAGNLKGHLLMIHGDIDPVVVWQHSLGFLKACVEADTYPDYFVYPRHEHNVTGKDRPHLH EECCCCEEEEEEECCCCEEEEEEHHHHHHHHHHHCCCCCCEEEECCCCCCCCCCCCCHHH EKITRYFDDYLKN HHHHHHHHHHHCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: NA