| Definition | Treponema pallidum subsp. pallidum SS14, complete genome. |
|---|---|
| Accession | NC_010741 |
| Length | 1,139,457 |
Click here to switch to the map view.
The map label for this gene is degP [H]
Identifier: 189025774
GI number: 189025774
Start: 590131
End: 592131
Strand: Reverse
Name: degP [H]
Synonym: TPASS_0546
Alternate gene names: 189025774
Gene position: 592131-590131 (Counterclockwise)
Preceding gene: 189025775
Following gene: 189025773
Centisome position: 51.97
GC content: 55.17
Gene sequence:
>2001_bases GTGGCTGGTAGAGCGTGTAGAAGATATTCCCCCCGATATCTATGCCTTCAGTGCGGTGGGCATCAGTGCAGGGGCTTCCA CCCCAGACTGTGTTATCGCTGCTGTGGAGCAGGCGCTGCGCACGGGCGGCGCGCCTGTCGCTTCTCGGGTGTCTTCCTCT GCTCTGCCCAAGGTGAGTACCTGCAGGGCTGTTTGTGCGGCGGCTACTTCTTCCGTCGGTTCAGCGGGTGCATCCGGCGC GGTGTCGCCCGGTGCTGTCCGACCTTTTGCTGTAGGCTCCGTGCGGTGAAAACCGCTTCCCTTTGTCTGCGAAGTGCATG GCTGAACGTTGCGCTCGGCGGGGTGCTGGGTGTCCTTTCCGGTTGTCGTGTCTTCGACGAAAGGGCGGATGTGCGCGTCG ACCGTACGGGAAAAGAATACCTCGATGCACAGGTTGCGTGTGCAAAAGAGGAGCTGCGCGCGCGTCCTCTGCGGGCGCTT ATGTGTGCAATTGCGCTCAAAAGAAATGCCCCAGCACATCAGAAGGTGGCTCAGCTGTATGCCCAGGCGCTTGCGCGCGT CAAAGAGGCGTTTCGCTATTCAGTGGAGAAACAGAAGTGGTCGGAGGCACTTGTGTTTTTTCGTTCCCTCTCGGCACTTC GCATTCCGCTGAAGGACTGGACGGAGCGATCGCTGCATCGTGCGCAAATTGAACAGTGGAAAAAGGAGGGTGCGCACGTA TTGGTTGCGGCGCAAGAGAAGCGCGCCGGAACTTCTGCTGCGCGGAGTCCGGCAGCCATGATAAAGGGGACGGTCACCAT TTTGGTAGATCGAGGAATTCGCGTAGAGCACGGACGCGGGTTTGCAGATCGAGTTATCGGGTCAGGTTTTTTCATCGACA AGAGGGGCTATATCGTCACTAACTACCACGTTATCAGAAGCGAGGTAGATCCTGCGTACGAAGGGTATTCGCGTGCGTAC ATCAAGCTCCCCTCAGACAACACCGTGAAAGTTCCGGTGCGCGTTGTCGGGTGGGATGCGCTTGCAGATCTTGCATTGCT AAAAACAGAAATTACTCCTGAGGTGGTGTTTGGCTTAGGTTCCTCAAAGAATTTGGACGTGGGGAGTAAAATCTACGCGA TAGGATCGCCTGCTGGGCTTGAACGAACGCTTACTTCTGGCATCGTGTCTGCGAAAAAGCGCAAACTGCTTTCAGTCGGT GGGGGAGTGCTGCAGATAGACGCATCCATTAATCGAGGGAACTCAGGCGGTCCAGTTATCGACGAGGAAGGGTGCGTTCA GGCAGTAGCGTTTGCAGGTGTGGAGCAGCATGCAGGGCTTAATTTTGCCATTCCTGTAGAATTGCTCAAGCAGGTGCTGC CAAGCTTGTACCGCGGGGGATTGGTGACGCATCCGTGGCTTGGTGCGTTTGGTGAAACACACCGTGTGTGGAAAAATGCT GGCGTCGGCGGTGTGCTTTCTTCGTACGTTATTCCTGGCAGTCCTCTCTCGTACGCAGGAATACCAGAAGGGGCAATTAT TACCACGGTCAATGATGCATCCGTTTCTTGTGTAGCTGACTTACAGGCAGAGTTGGAAAAATACGTGCCCGAAACTATCG TCCGTCTTGCAGGGTACCGACTGCGGGACAAGAGCAAACTGCATGATCTGGCCGCCTATGAGCAGGATGAATGGTACTGC CAGTTAGGAGTACGGCCGGAACATCCTGCCCGGATCCTGTATAAGTACGACTTATCGTACCGGGCCTTCTTGCCCCTTTT TGGGATGCGCTTGGCGCGCACCGGCACGCGCAACACCTACCGTGTGGAGTCACTGGTTCCTGGCAATTTTGCAGATGAGC ATGGCTTTAGCACGTACGACGTAATAGAAATCCAAAACATATACATGATTGAGGCAAGTGAGGCGATTGTCGCAGACGTG TACGCTAAACGGCGCAAGGCCGGGTACATAGACACGTTCATGCGATTGGTGGCAGCACTGGATAATCCATCCTTTTTCTA A
Upstream 100 bases:
>100_bases CTCTTGCGCCCACGGTGGAAGCGCTCCTGGTGATCGGCGGCGCACACTCGGCAAATACCCAGCGTCTACTCCACACCGCG CGCGAAACGTCGCTGCCTAC
Downstream 100 bases:
>100_bases TTTCTATATTCCTCGCGCGGGTATCAGGGTGTGAGGGGAAAGAAGTGTCAAATCAGAATGCGCTGGTGAACATGAGGAGG AAATATGAAAGGTACAGGGA
Product: periplasmic serine protease
Products: NA
Alternate protein names: Antigen htrA [H]
Number of amino acids: Translated: 666; Mature: 665
Protein sequence:
>666_residues MAGRACRRYSPRYLCLQCGGHQCRGFHPRLCYRCCGAGAAHGRRACRFSGVFLCSAQGEYLQGCLCGGYFFRRFSGCIRR GVARCCPTFCCRLRAVKTASLCLRSAWLNVALGGVLGVLSGCRVFDERADVRVDRTGKEYLDAQVACAKEELRARPLRAL MCAIALKRNAPAHQKVAQLYAQALARVKEAFRYSVEKQKWSEALVFFRSLSALRIPLKDWTERSLHRAQIEQWKKEGAHV LVAAQEKRAGTSAARSPAAMIKGTVTILVDRGIRVEHGRGFADRVIGSGFFIDKRGYIVTNYHVIRSEVDPAYEGYSRAY IKLPSDNTVKVPVRVVGWDALADLALLKTEITPEVVFGLGSSKNLDVGSKIYAIGSPAGLERTLTSGIVSAKKRKLLSVG GGVLQIDASINRGNSGGPVIDEEGCVQAVAFAGVEQHAGLNFAIPVELLKQVLPSLYRGGLVTHPWLGAFGETHRVWKNA GVGGVLSSYVIPGSPLSYAGIPEGAIITTVNDASVSCVADLQAELEKYVPETIVRLAGYRLRDKSKLHDLAAYEQDEWYC QLGVRPEHPARILYKYDLSYRAFLPLFGMRLARTGTRNTYRVESLVPGNFADEHGFSTYDVIEIQNIYMIEASEAIVADV YAKRRKAGYIDTFMRLVAALDNPSFF
Sequences:
>Translated_666_residues MAGRACRRYSPRYLCLQCGGHQCRGFHPRLCYRCCGAGAAHGRRACRFSGVFLCSAQGEYLQGCLCGGYFFRRFSGCIRR GVARCCPTFCCRLRAVKTASLCLRSAWLNVALGGVLGVLSGCRVFDERADVRVDRTGKEYLDAQVACAKEELRARPLRAL MCAIALKRNAPAHQKVAQLYAQALARVKEAFRYSVEKQKWSEALVFFRSLSALRIPLKDWTERSLHRAQIEQWKKEGAHV LVAAQEKRAGTSAARSPAAMIKGTVTILVDRGIRVEHGRGFADRVIGSGFFIDKRGYIVTNYHVIRSEVDPAYEGYSRAY IKLPSDNTVKVPVRVVGWDALADLALLKTEITPEVVFGLGSSKNLDVGSKIYAIGSPAGLERTLTSGIVSAKKRKLLSVG GGVLQIDASINRGNSGGPVIDEEGCVQAVAFAGVEQHAGLNFAIPVELLKQVLPSLYRGGLVTHPWLGAFGETHRVWKNA GVGGVLSSYVIPGSPLSYAGIPEGAIITTVNDASVSCVADLQAELEKYVPETIVRLAGYRLRDKSKLHDLAAYEQDEWYC QLGVRPEHPARILYKYDLSYRAFLPLFGMRLARTGTRNTYRVESLVPGNFADEHGFSTYDVIEIQNIYMIEASEAIVADV YAKRRKAGYIDTFMRLVAALDNPSFF >Mature_665_residues AGRACRRYSPRYLCLQCGGHQCRGFHPRLCYRCCGAGAAHGRRACRFSGVFLCSAQGEYLQGCLCGGYFFRRFSGCIRRG VARCCPTFCCRLRAVKTASLCLRSAWLNVALGGVLGVLSGCRVFDERADVRVDRTGKEYLDAQVACAKEELRARPLRALM CAIALKRNAPAHQKVAQLYAQALARVKEAFRYSVEKQKWSEALVFFRSLSALRIPLKDWTERSLHRAQIEQWKKEGAHVL VAAQEKRAGTSAARSPAAMIKGTVTILVDRGIRVEHGRGFADRVIGSGFFIDKRGYIVTNYHVIRSEVDPAYEGYSRAYI KLPSDNTVKVPVRVVGWDALADLALLKTEITPEVVFGLGSSKNLDVGSKIYAIGSPAGLERTLTSGIVSAKKRKLLSVGG GVLQIDASINRGNSGGPVIDEEGCVQAVAFAGVEQHAGLNFAIPVELLKQVLPSLYRGGLVTHPWLGAFGETHRVWKNAG VGGVLSSYVIPGSPLSYAGIPEGAIITTVNDASVSCVADLQAELEKYVPETIVRLAGYRLRDKSKLHDLAAYEQDEWYCQ LGVRPEHPARILYKYDLSYRAFLPLFGMRLARTGTRNTYRVESLVPGNFADEHGFSTYDVIEIQNIYMIEASEAIVADVY AKRRKAGYIDTFMRLVAALDNPSFF
Specific function: Serine Protease That Is Required At High Temperature. Involved In The Degradation Of Damaged Proteins. It Can Degrade Icia, Ada, Casein And Globin. Shared Specificity With Degq. [C]
COG id: COG0265
COG function: function code O; Trypsin-like serine proteases, typically periplasmic, contain C-terminal PDZ domain
Gene ontology:
Cell location: Periplasm (Potential) [H]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 2 PDZ (DHR) domains [H]
Homologues:
Organism=Homo sapiens, GI4506141, Length=258, Percent_Identity=30.2325581395349, Blast_Score=99, Evalue=2e-20, Organism=Homo sapiens, GI24308541, Length=186, Percent_Identity=36.0215053763441, Blast_Score=96, Evalue=1e-19, Organism=Homo sapiens, GI22129776, Length=256, Percent_Identity=28.515625, Blast_Score=92, Evalue=1e-18, Organism=Homo sapiens, GI7019477, Length=173, Percent_Identity=35.8381502890173, Blast_Score=79, Evalue=1e-14, Organism=Escherichia coli, GI1786356, Length=253, Percent_Identity=34.3873517786561, Blast_Score=107, Evalue=2e-24, Organism=Escherichia coli, GI1789630, Length=294, Percent_Identity=28.9115646258503, Blast_Score=102, Evalue=6e-23, Organism=Escherichia coli, GI1789629, Length=267, Percent_Identity=31.0861423220974, Blast_Score=100, Evalue=2e-22, Organism=Drosophila melanogaster, GI24646839, Length=261, Percent_Identity=29.1187739463602, Blast_Score=99, Evalue=7e-21,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR001478 - InterPro: IPR009003 - InterPro: IPR011782 - InterPro: IPR001254 - InterPro: IPR001940 [H]
Pfam domain/function: PF00595 PDZ; PF00089 Trypsin [H]
EC number: 3.4.21.- [C]
Molecular weight: Translated: 73321; Mature: 73190
Theoretical pI: Translated: 9.49; Mature: 9.49
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
3.5 %Cys (Translated Protein) 0.9 %Met (Translated Protein) 4.4 %Cys+Met (Translated Protein) 3.5 %Cys (Mature Protein) 0.8 %Met (Mature Protein) 4.2 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MAGRACRRYSPRYLCLQCGGHQCRGFHPRLCYRCCGAGAAHGRRACRFSGVFLCSAQGEY CCCCCCHHCCCCEEEEECCCCCCCCCCHHHHHHHHCCCCCCCCCCEEECCEEEECCCCHH LQGCLCGGYFFRRFSGCIRRGVARCCPTFCCRLRAVKTASLCLRSAWLNVALGGVLGVLS HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH GCRVFDERADVRVDRTGKEYLDAQVACAKEELRARPLRALMCAIALKRNAPAHQKVAQLY HHHHHHCCCCEEECCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHH AQALARVKEAFRYSVEKQKWSEALVFFRSLSALRIPLKDWTERSLHRAQIEQWKKEGAHV HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHCCCEE LVAAQEKRAGTSAARSPAAMIKGTVTILVDRGIRVEHGRGFADRVIGSGFFIDKRGYIVT EEEECCCCCCCHHHCCCHHHHCCEEEEEEECCEEEECCCCHHHHHHCCCEEEECCCEEEE NYHVIRSEVDPAYEGYSRAYIKLPSDNTVKVPVRVVGWDALADLALLKTEITPEVVFGLG EEEEEECCCCHHHCCCCEEEEECCCCCEEEEEEEEECHHHHHHHHHHHHCCCHHHEEECC SSKNLDVGSKIYAIGSPAGLERTLTSGIVSAKKRKLLSVGGGVLQIDASINRGNSGGPVI CCCCCCCCCEEEEECCCCCHHHHHHHHHHHHHHHHHHHCCCCEEEEEEECCCCCCCCCCC DEEGCVQAVAFAGVEQHAGLNFAIPVELLKQVLPSLYRGGLVTHPWLGAFGETHRVWKNA CCCHHHHHHHHHCHHHHCCCCEEEHHHHHHHHHHHHHHCCCCCCCCHHCCCCHHHHHHCC GVGGVLSSYVIPGSPLSYAGIPEGAIITTVNDASVSCVADLQAELEKYVPETIVRLAGYR CCCHHHHHHCCCCCCCCCCCCCCCCEEEEECCCCHHHHHHHHHHHHHHHHHHHHHHCCCC LRDKSKLHDLAAYEQDEWYCQLGVRPEHPARILYKYDLSYRAFLPLFGMRLARTGTRNTY CCCHHHHHHHHHCCCCCEEEEECCCCCCCCEEEEEECCCHHHHHHHHHHHHHHCCCCCCE RVESLVPGNFADEHGFSTYDVIEIQNIYMIEASEAIVADVYAKRRKAGYIDTFMRLVAAL EEEEECCCCCCCCCCCCCEEEEEEEEEEEEECCHHHHHHHHHHHHCCCHHHHHHHHHHHH DNPSFF CCCCCC >Mature Secondary Structure AGRACRRYSPRYLCLQCGGHQCRGFHPRLCYRCCGAGAAHGRRACRFSGVFLCSAQGEY CCCCCHHCCCCEEEEECCCCCCCCCCHHHHHHHHCCCCCCCCCCEEECCEEEECCCCHH LQGCLCGGYFFRRFSGCIRRGVARCCPTFCCRLRAVKTASLCLRSAWLNVALGGVLGVLS HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH GCRVFDERADVRVDRTGKEYLDAQVACAKEELRARPLRALMCAIALKRNAPAHQKVAQLY HHHHHHCCCCEEECCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHH AQALARVKEAFRYSVEKQKWSEALVFFRSLSALRIPLKDWTERSLHRAQIEQWKKEGAHV HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHCCCEE LVAAQEKRAGTSAARSPAAMIKGTVTILVDRGIRVEHGRGFADRVIGSGFFIDKRGYIVT EEEECCCCCCCHHHCCCHHHHCCEEEEEEECCEEEECCCCHHHHHHCCCEEEECCCEEEE NYHVIRSEVDPAYEGYSRAYIKLPSDNTVKVPVRVVGWDALADLALLKTEITPEVVFGLG EEEEEECCCCHHHCCCCEEEEECCCCCEEEEEEEEECHHHHHHHHHHHHCCCHHHEEECC SSKNLDVGSKIYAIGSPAGLERTLTSGIVSAKKRKLLSVGGGVLQIDASINRGNSGGPVI CCCCCCCCCEEEEECCCCCHHHHHHHHHHHHHHHHHHHCCCCEEEEEEECCCCCCCCCCC DEEGCVQAVAFAGVEQHAGLNFAIPVELLKQVLPSLYRGGLVTHPWLGAFGETHRVWKNA CCCHHHHHHHHHCHHHHCCCCEEEHHHHHHHHHHHHHHCCCCCCCCHHCCCCHHHHHHCC GVGGVLSSYVIPGSPLSYAGIPEGAIITTVNDASVSCVADLQAELEKYVPETIVRLAGYR CCCHHHHHHCCCCCCCCCCCCCCCCEEEEECCCCHHHHHHHHHHHHHHHHHHHHHHCCCC LRDKSKLHDLAAYEQDEWYCQLGVRPEHPARILYKYDLSYRAFLPLFGMRLARTGTRNTY CCCHHHHHHHHHCCCCCEEEEECCCCCCCCEEEEEECCCHHHHHHHHHHHHHHCCCCCCE RVESLVPGNFADEHGFSTYDVIEIQNIYMIEASEAIVADVYAKRRKAGYIDTFMRLVAAL EEEEECCCCCCCCCCCCCEEEEEEEEEEEEECCHHHHHHHHHHHHCCCHHHHHHHHHHHH DNPSFF CCCCCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: Serine endopeptidases [C]
General reaction: Hydrolase; Acting on peptide bonds (Peptidases) [C]
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 8027347 [H]