Definition Parabacteroides distasonis ATCC 8503 chromosome, complete genome.
Accession NC_009615
Length 4,811,379

Click here to switch to the map view.

The map label for this gene is ptpA [H]

Identifier: 150009679

GI number: 150009679

Start: 3709766

End: 3711967

Strand: Direct

Name: ptpA [H]

Synonym: BDI_3094

Alternate gene names: 150009679

Gene position: 3709766-3711967 (Clockwise)

Preceding gene: 150009678

Following gene: 150009680

Centisome position: 77.1

GC content: 47.59

Gene sequence:

>2202_bases
ATGATGATTATGAGGATTAAATCATCTTTATTCATAAGCCTATGTCTGATTTTATTAACGATGTCGATTACCGCCCAAGA
TAAGCAACTCTCCTTGCACGACTTGATTCCGGGAGGAAAAACGTATAGCCGCTTCGTACCTCGTGACTTGAAACAGTTAC
GATGGTGCGGGGACGAGTACTTATATGTTAAGGGAGATAGCGTGTTAGGAGCTAAGCCGGGGAAAAAAGAAGAGGTCCTT
TTTTCGTTGGAAAGACTGAATGGGGCCTTGACGGTGGCAAACCTACAGACGGTTGGTTCCTTGCCTAGCTTTTCGGTACC
CTATGAAAGTGGTTCGGTCTTGGCTTTTACTAGCAAACAGCACCGGATTCATTATGACTATAAGAAGAATAAGGTAGTCG
CTGATTATGCTTTGAAGAATAACTGGGCGAATTATGACTTTTGTCCGGCTACGAATAACTTAGCTTTTACGGAGGGAAAC
AATGTGCATATTTTATCCCCGGATGGACGAAATACGATTGTTACACGTGAAACACAGGATGGAATCGTATGCGGACAGGC
TGTCCATCAACGGGAGTTCGGGATTACGAAAGGTATGTTTTGGTCTCCTAAAGGTTCGGCTCTAGCGTTTTATCGTATGG
ATGAGCGTATGGTGACCGCTTACCCGCTGGTGAATATCGATACTCGTTGCGCTACGCCGGTTCCTCATAAATATCCGATG
GCTGGAATGAAGAGCCATGAGGTTACGGTGGGTGTCTATCAGGTAGCTACCGGGCAGACGGTTTGGTTGGAGACAGGCTT
GCCGAAAGAGAAATATTTAACAAATATCGCTTGGAGTCCGGATGAGAAGAGTATTTATATCGCTGAGTTGAATCGTGAGC
AGAACGAGATGCATTTGGTGCGGTACTCTGCCTTGACGGGAAAGAAAGAGGCTGATCTGTTTACCGAGACGGATCGTTGT
TATGTGGAGCCGCAGCATCCCGTGCTTTTCTTGCCGAACGATCCGGATAAGTTTATCTGGCAGAGTGAGGCGGATGGCTA
TAACCATCTATATCTGTATGATACGACTGGAAAGGAATTAAGGAAGCTAACCGGTGGGGAATGGGTGGTTACCAAGGTGC
TAGGCTTTAGCAAAGACGGAAATAAGGTGATTTTCGAGGGAACGGCACCTCATCCCGTATCTCCGAATATGCAAGGAACG
GGGATGCAACGTTATATTTGGGAGACGGATTTGAGAACGGGTGATATCATGAATTGCTTGAGTTGGAAAGTGGGCGTGCA
CCGTTGGTTGCTGAGTCCCTCCGGCGAATATGCGATTGATTATGTAAGTTCTCCTTCTACCCCGAGGGATATCGATTTAA
TCCGTGTAAAGGACGCTAAGGTGATTTCTACCTTACTTTCCGCTCCGGATCCTTTTAAATCGTATCGGATGCCGCAGATC
AAGGTTGGATATATCCTTGCTGCCGATGGTAAGACTCGCTTGAATTACCGGTTGACTTTACCGCCGGATTTGGATGAGAC
GAAGAAGTATCCTACGATTGTCTACGTCTATGGAGGCCCGCATGCCCAATTGGTTACGGGCGACTGGCAAAACGGGGCTC
GTGGCTGGGATCTCTATATGGCACAAAGAGGTTATGTGATGTTTTCCGTGGATAGCCGTGGCTCGGCGAACCGCGGGCAT
GCTTTTGAGAGCGTGATTCATCGTAATTTGGGTATCAACGAGATGGCGGATCAAGTGAAGGGGGTCGAGTTCTTGAAATC
CTTGCCTTATGTGGATGCCGACCGTATCGGGGTACATGGCTGGAGTTATGGCGGTTTTATGACAACGAACTTGATGCTGA
CGTATCCGGAGATCTTTAAGGTGGGCGTGGCCGGAGGGCCGGTTATCGACTGGAGCAATTACGAGATCATGTATGGCGAG
CGTTATATGGATCGCCCGCAGGATAATCCGGAAGGTTATAAGAACGCGAACCTGAAACTGAAGGCCGGCAATCTGAAAGG
CCATCTGCTGATGATACATGGGGATATCGATCCGGTGGTAGTGTGGCAACACAGCCTAGGTTTCTTGAAGGCTTGCGTAG
AGGCTGATACGTATCCGGATTACTTTGTTTATCCTCGTCATGAGCATAACGTGACCGGTAAGGACCGTCCGCATTTGCAT
GAGAAGATTACGAGGTATTTCGATGATTACTTGAAAAATTGA

Upstream 100 bases:

>100_bases
TATCGGGATGAGGATGACCGTAAGAAAGGGTTTGGCGATCATAAGCGGGATGGAAAGCGCCCGTTTAGCAAACCTATAAA
GCCTATAAAACGGAGAGGGT

Downstream 100 bases:

>100_bases
GAATTGAAAATTAGAAGAGATATGAATATATTGTTATTAGGCTCTGGTGGGCGTGAGCATGCGATCGCTTGGAAGATCGC
TCAAAGCCCGAAAGTTGATA

Product: dipeptidyl peptidase IV

Products: NA

Alternate protein names: PTP; Prolyl tripeptidyl peptidase A [H]

Number of amino acids: Translated: 733; Mature: 733

Protein sequence:

>733_residues
MMIMRIKSSLFISLCLILLTMSITAQDKQLSLHDLIPGGKTYSRFVPRDLKQLRWCGDEYLYVKGDSVLGAKPGKKEEVL
FSLERLNGALTVANLQTVGSLPSFSVPYESGSVLAFTSKQHRIHYDYKKNKVVADYALKNNWANYDFCPATNNLAFTEGN
NVHILSPDGRNTIVTRETQDGIVCGQAVHQREFGITKGMFWSPKGSALAFYRMDERMVTAYPLVNIDTRCATPVPHKYPM
AGMKSHEVTVGVYQVATGQTVWLETGLPKEKYLTNIAWSPDEKSIYIAELNREQNEMHLVRYSALTGKKEADLFTETDRC
YVEPQHPVLFLPNDPDKFIWQSEADGYNHLYLYDTTGKELRKLTGGEWVVTKVLGFSKDGNKVIFEGTAPHPVSPNMQGT
GMQRYIWETDLRTGDIMNCLSWKVGVHRWLLSPSGEYAIDYVSSPSTPRDIDLIRVKDAKVISTLLSAPDPFKSYRMPQI
KVGYILAADGKTRLNYRLTLPPDLDETKKYPTIVYVYGGPHAQLVTGDWQNGARGWDLYMAQRGYVMFSVDSRGSANRGH
AFESVIHRNLGINEMADQVKGVEFLKSLPYVDADRIGVHGWSYGGFMTTNLMLTYPEIFKVGVAGGPVIDWSNYEIMYGE
RYMDRPQDNPEGYKNANLKLKAGNLKGHLLMIHGDIDPVVVWQHSLGFLKACVEADTYPDYFVYPRHEHNVTGKDRPHLH
EKITRYFDDYLKN

Sequences:

>Translated_733_residues
MMIMRIKSSLFISLCLILLTMSITAQDKQLSLHDLIPGGKTYSRFVPRDLKQLRWCGDEYLYVKGDSVLGAKPGKKEEVL
FSLERLNGALTVANLQTVGSLPSFSVPYESGSVLAFTSKQHRIHYDYKKNKVVADYALKNNWANYDFCPATNNLAFTEGN
NVHILSPDGRNTIVTRETQDGIVCGQAVHQREFGITKGMFWSPKGSALAFYRMDERMVTAYPLVNIDTRCATPVPHKYPM
AGMKSHEVTVGVYQVATGQTVWLETGLPKEKYLTNIAWSPDEKSIYIAELNREQNEMHLVRYSALTGKKEADLFTETDRC
YVEPQHPVLFLPNDPDKFIWQSEADGYNHLYLYDTTGKELRKLTGGEWVVTKVLGFSKDGNKVIFEGTAPHPVSPNMQGT
GMQRYIWETDLRTGDIMNCLSWKVGVHRWLLSPSGEYAIDYVSSPSTPRDIDLIRVKDAKVISTLLSAPDPFKSYRMPQI
KVGYILAADGKTRLNYRLTLPPDLDETKKYPTIVYVYGGPHAQLVTGDWQNGARGWDLYMAQRGYVMFSVDSRGSANRGH
AFESVIHRNLGINEMADQVKGVEFLKSLPYVDADRIGVHGWSYGGFMTTNLMLTYPEIFKVGVAGGPVIDWSNYEIMYGE
RYMDRPQDNPEGYKNANLKLKAGNLKGHLLMIHGDIDPVVVWQHSLGFLKACVEADTYPDYFVYPRHEHNVTGKDRPHLH
EKITRYFDDYLKN
>Mature_733_residues
MMIMRIKSSLFISLCLILLTMSITAQDKQLSLHDLIPGGKTYSRFVPRDLKQLRWCGDEYLYVKGDSVLGAKPGKKEEVL
FSLERLNGALTVANLQTVGSLPSFSVPYESGSVLAFTSKQHRIHYDYKKNKVVADYALKNNWANYDFCPATNNLAFTEGN
NVHILSPDGRNTIVTRETQDGIVCGQAVHQREFGITKGMFWSPKGSALAFYRMDERMVTAYPLVNIDTRCATPVPHKYPM
AGMKSHEVTVGVYQVATGQTVWLETGLPKEKYLTNIAWSPDEKSIYIAELNREQNEMHLVRYSALTGKKEADLFTETDRC
YVEPQHPVLFLPNDPDKFIWQSEADGYNHLYLYDTTGKELRKLTGGEWVVTKVLGFSKDGNKVIFEGTAPHPVSPNMQGT
GMQRYIWETDLRTGDIMNCLSWKVGVHRWLLSPSGEYAIDYVSSPSTPRDIDLIRVKDAKVISTLLSAPDPFKSYRMPQI
KVGYILAADGKTRLNYRLTLPPDLDETKKYPTIVYVYGGPHAQLVTGDWQNGARGWDLYMAQRGYVMFSVDSRGSANRGH
AFESVIHRNLGINEMADQVKGVEFLKSLPYVDADRIGVHGWSYGGFMTTNLMLTYPEIFKVGVAGGPVIDWSNYEIMYGE
RYMDRPQDNPEGYKNANLKLKAGNLKGHLLMIHGDIDPVVVWQHSLGFLKACVEADTYPDYFVYPRHEHNVTGKDRPHLH
EKITRYFDDYLKN

Specific function: Serine proteinase. Releases tripeptides from the free amino terminus of proteins. Has a requirement for Pro in the P1 position, but is inactivated by Pro in the P1' position [H]

COG id: COG1506

COG function: function code E; Dipeptidyl aminopeptidases/acylaminoacyl-peptidases

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Belongs to the peptidase S9B family [H]

Homologues:

Organism=Homo sapiens, GI37577089, Length=669, Percent_Identity=26.0089686098655, Blast_Score=179, Evalue=8e-45,
Organism=Homo sapiens, GI18450280, Length=669, Percent_Identity=26.0089686098655, Blast_Score=179, Evalue=1e-44,
Organism=Homo sapiens, GI18765694, Length=746, Percent_Identity=24.9329758713137, Blast_Score=177, Evalue=3e-44,
Organism=Homo sapiens, GI295842403, Length=594, Percent_Identity=25.7575757575758, Blast_Score=170, Evalue=4e-42,
Organism=Homo sapiens, GI85787627, Length=594, Percent_Identity=25.7575757575758, Blast_Score=170, Evalue=5e-42,
Organism=Homo sapiens, GI52426756, Length=594, Percent_Identity=25.7575757575758, Blast_Score=170, Evalue=5e-42,
Organism=Homo sapiens, GI295849272, Length=594, Percent_Identity=25.7575757575758, Blast_Score=169, Evalue=6e-42,
Organism=Homo sapiens, GI295842359, Length=594, Percent_Identity=25.7575757575758, Blast_Score=169, Evalue=7e-42,
Organism=Homo sapiens, GI16933540, Length=766, Percent_Identity=23.8903394255875, Blast_Score=160, Evalue=3e-39,
Organism=Homo sapiens, GI194394146, Length=393, Percent_Identity=28.498727735369, Blast_Score=159, Evalue=9e-39,
Organism=Homo sapiens, GI86792778, Length=619, Percent_Identity=23.5864297253635, Blast_Score=137, Evalue=3e-32,
Organism=Homo sapiens, GI86792774, Length=619, Percent_Identity=23.5864297253635, Blast_Score=137, Evalue=4e-32,
Organism=Homo sapiens, GI86792863, Length=619, Percent_Identity=23.5864297253635, Blast_Score=137, Evalue=4e-32,
Organism=Homo sapiens, GI37577091, Length=668, Percent_Identity=22.9041916167665, Blast_Score=108, Evalue=2e-23,
Organism=Caenorhabditis elegans, GI17508017, Length=229, Percent_Identity=34.9344978165939, Blast_Score=146, Evalue=4e-35,
Organism=Caenorhabditis elegans, GI17508019, Length=229, Percent_Identity=34.9344978165939, Blast_Score=146, Evalue=4e-35,
Organism=Caenorhabditis elegans, GI17564634, Length=618, Percent_Identity=25.2427184466019, Blast_Score=135, Evalue=6e-32,
Organism=Caenorhabditis elegans, GI17564632, Length=618, Percent_Identity=25.0809061488673, Blast_Score=135, Evalue=7e-32,
Organism=Caenorhabditis elegans, GI17550672, Length=573, Percent_Identity=23.9092495636998, Blast_Score=122, Evalue=6e-28,
Organism=Saccharomyces cerevisiae, GI6321817, Length=614, Percent_Identity=26.2214983713355, Blast_Score=163, Evalue=8e-41,
Organism=Saccharomyces cerevisiae, GI6324793, Length=619, Percent_Identity=24.3941841680129, Blast_Score=147, Evalue=7e-36,
Organism=Drosophila melanogaster, GI45551969, Length=642, Percent_Identity=23.8317757009346, Blast_Score=172, Evalue=9e-43,
Organism=Drosophila melanogaster, GI45550825, Length=642, Percent_Identity=23.8317757009346, Blast_Score=172, Evalue=1e-42,
Organism=Drosophila melanogaster, GI45553511, Length=642, Percent_Identity=23.8317757009346, Blast_Score=172, Evalue=1e-42,
Organism=Drosophila melanogaster, GI17933704, Length=641, Percent_Identity=26.8330733229329, Blast_Score=156, Evalue=5e-38,
Organism=Drosophila melanogaster, GI161083744, Length=641, Percent_Identity=26.8330733229329, Blast_Score=155, Evalue=7e-38,
Organism=Drosophila melanogaster, GI221331178, Length=641, Percent_Identity=26.8330733229329, Blast_Score=155, Evalue=7e-38,
Organism=Drosophila melanogaster, GI24582257, Length=263, Percent_Identity=34.6007604562738, Blast_Score=155, Evalue=7e-38,
Organism=Drosophila melanogaster, GI24582032, Length=615, Percent_Identity=26.0162601626016, Blast_Score=152, Evalue=6e-37,
Organism=Drosophila melanogaster, GI45551475, Length=239, Percent_Identity=30.1255230125523, Blast_Score=127, Evalue=3e-29,
Organism=Drosophila melanogaster, GI221372263, Length=239, Percent_Identity=30.1255230125523, Blast_Score=127, Evalue=3e-29,
Organism=Drosophila melanogaster, GI221372266, Length=239, Percent_Identity=30.1255230125523, Blast_Score=127, Evalue=3e-29,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR001375
- InterPro:   IPR002469 [H]

Pfam domain/function: PF00930 DPPIV_N; PF00326 Peptidase_S9 [H]

EC number: =3.4.14.12 [H]

Molecular weight: Translated: 83075; Mature: 83075

Theoretical pI: Translated: 7.69; Mature: 7.69

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.1 %Cys     (Translated Protein)
3.0 %Met     (Translated Protein)
4.1 %Cys+Met (Translated Protein)
1.1 %Cys     (Mature Protein)
3.0 %Met     (Mature Protein)
4.1 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MMIMRIKSSLFISLCLILLTMSITAQDKQLSLHDLIPGGKTYSRFVPRDLKQLRWCGDEY
CEEEEEHHHHHHHHHHHHHHHHCCCCCCCEEHHHCCCCCCHHHHHCHHHHHHHHHCCCCE
LYVKGDSVLGAKPGKKEEVLFSLERLNGALTVANLQTVGSLPSFSVPYESGSVLAFTSKQ
EEEECCEEECCCCCCHHHHHHHHHHCCCEEEEEEEHHHCCCCCCCCCCCCCCEEEEECCC
HRIHYDYKKNKVVADYALKNNWANYDFCPATNNLAFTEGNNVHILSPDGRNTIVTRETQD
CEEEEEECCCEEEEEEHHHCCCCCCEECCCCCCEEEECCCEEEEECCCCCCEEEEECCCC
GIVCGQAVHQREFGITKGMFWSPKGSALAFYRMDERMVTAYPLVNIDTRCATPVPHKYPM
CEEECHHHHHHHCCCCCCEEECCCCCEEEEEEECCEEEEEEEEEECCCCCCCCCCCCCCC
AGMKSHEVTVGVYQVATGQTVWLETGLPKEKYLTNIAWSPDEKSIYIAELNREQNEMHLV
CCCCCCEEEEEEEEEECCCEEEEECCCCHHHHHEECCCCCCCCEEEEEECCCCCCCEEEE
RYSALTGKKEADLFTETDRCYVEPQHPVLFLPNDPDKFIWQSEADGYNHLYLYDTTGKEL
EEEECCCCCCCCEEECCCEEEECCCCCEEEECCCCCCEEEECCCCCCEEEEEEECCCHHH
RKLTGGEWVVTKVLGFSKDGNKVIFEGTAPHPVSPNMQGTGMQRYIWETDLRTGDIMNCL
HHHCCCCEEEEEEECCCCCCCEEEEECCCCCCCCCCCCCCCCEEEEEECCCCCCHHHHHH
SWKVGVHRWLLSPSGEYAIDYVSSPSTPRDIDLIRVKDAKVISTLLSAPDPFKSYRMPQI
HHHHCCEEEEECCCCCEEEEEECCCCCCCCEEEEEECCHHHHHHHHCCCCCHHHCCCCEE
KVGYILAADGKTRLNYRLTLPPDLDETKKYPTIVYVYGGPHAQLVTGDWQNGARGWDLYM
EEEEEEEECCCEEEEEEEECCCCCCHHCCCCEEEEEECCCCEEEEECCCCCCCCCEEEEE
AQRGYVMFSVDSRGSANRGHAFESVIHRNLGINEMADQVKGVEFLKSLPYVDADRIGVHG
EECCEEEEEECCCCCCCCCHHHHHHHHHCCCHHHHHHHHHHHHHHHHCCCCCCCCEEECE
WSYGGFMTTNLMLTYPEIFKVGVAGGPVIDWSNYEIMYGERYMDRPQDNPEGYKNANLKL
ECCCCEEEEEEEEECHHHEEEECCCCCEEECCCEEEEECCHHCCCCCCCCCCCCCCCEEE
KAGNLKGHLLMIHGDIDPVVVWQHSLGFLKACVEADTYPDYFVYPRHEHNVTGKDRPHLH
EECCCCEEEEEEECCCCEEEEEEHHHHHHHHHHHCCCCCCEEEECCCCCCCCCCCCCHHH
EKITRYFDDYLKN
HHHHHHHHHHHCC
>Mature Secondary Structure
MMIMRIKSSLFISLCLILLTMSITAQDKQLSLHDLIPGGKTYSRFVPRDLKQLRWCGDEY
CEEEEEHHHHHHHHHHHHHHHHCCCCCCCEEHHHCCCCCCHHHHHCHHHHHHHHHCCCCE
LYVKGDSVLGAKPGKKEEVLFSLERLNGALTVANLQTVGSLPSFSVPYESGSVLAFTSKQ
EEEECCEEECCCCCCHHHHHHHHHHCCCEEEEEEEHHHCCCCCCCCCCCCCCEEEEECCC
HRIHYDYKKNKVVADYALKNNWANYDFCPATNNLAFTEGNNVHILSPDGRNTIVTRETQD
CEEEEEECCCEEEEEEHHHCCCCCCEECCCCCCEEEECCCEEEEECCCCCCEEEEECCCC
GIVCGQAVHQREFGITKGMFWSPKGSALAFYRMDERMVTAYPLVNIDTRCATPVPHKYPM
CEEECHHHHHHHCCCCCCEEECCCCCEEEEEEECCEEEEEEEEEECCCCCCCCCCCCCCC
AGMKSHEVTVGVYQVATGQTVWLETGLPKEKYLTNIAWSPDEKSIYIAELNREQNEMHLV
CCCCCCEEEEEEEEEECCCEEEEECCCCHHHHHEECCCCCCCCEEEEEECCCCCCCEEEE
RYSALTGKKEADLFTETDRCYVEPQHPVLFLPNDPDKFIWQSEADGYNHLYLYDTTGKEL
EEEECCCCCCCCEEECCCEEEECCCCCEEEECCCCCCEEEECCCCCCEEEEEEECCCHHH
RKLTGGEWVVTKVLGFSKDGNKVIFEGTAPHPVSPNMQGTGMQRYIWETDLRTGDIMNCL
HHHCCCCEEEEEEECCCCCCCEEEEECCCCCCCCCCCCCCCCEEEEEECCCCCCHHHHHH
SWKVGVHRWLLSPSGEYAIDYVSSPSTPRDIDLIRVKDAKVISTLLSAPDPFKSYRMPQI
HHHHCCEEEEECCCCCEEEEEECCCCCCCCEEEEEECCHHHHHHHHCCCCCHHHCCCCEE
KVGYILAADGKTRLNYRLTLPPDLDETKKYPTIVYVYGGPHAQLVTGDWQNGARGWDLYM
EEEEEEEECCCEEEEEEEECCCCCCHHCCCCEEEEEECCCCEEEEECCCCCCCCCEEEEE
AQRGYVMFSVDSRGSANRGHAFESVIHRNLGINEMADQVKGVEFLKSLPYVDADRIGVHG
EECCEEEEEECCCCCCCCCHHHHHHHHHCCCHHHHHHHHHHHHHHHHCCCCCCCCEEECE
WSYGGFMTTNLMLTYPEIFKVGVAGGPVIDWSNYEIMYGERYMDRPQDNPEGYKNANLKL
ECCCCEEEEEEEEECHHHEEEECCCCCEEECCCEEEEECCHHCCCCCCCCCCCCCCCEEE
KAGNLKGHLLMIHGDIDPVVVWQHSLGFLKACVEADTYPDYFVYPRHEHNVTGKDRPHLH
EECCCCEEEEEEECCCCEEEEEEHHHHHHHHHHHCCCCCCEEEECCCCCCCCCCCCCHHH
EKITRYFDDYLKN
HHHHHHHHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA