| Definition | Rhodopseudomonas palustris HaA2, complete genome. |
|---|---|
| Accession | NC_007778 |
| Length | 5,331,656 |
Click here to switch to the map view.
The map label for this gene is ptrB [H]
Identifier: 86751067
GI number: 86751067
Start: 4519260
End: 4521386
Strand: Direct
Name: ptrB [H]
Synonym: RPB_3959
Alternate gene names: 86751067
Gene position: 4519260-4521386 (Clockwise)
Preceding gene: 86751061
Following gene: 86751068
Centisome position: 84.76
GC content: 66.67
Gene sequence:
>2127_bases ATGCAACGAGACCCGCTCATGACCCTGTCCCCGCCCCGCGACGCCACGCCTCCCGTCGCGCCGCGCCGTCCGCACGCCTT CACCACCCACGGCATCACCATCAACGACGACTATGCCTGGCTGAAGGACCCGAACTGGCAGGAGGTGCTGCGCGATCCGG CGCTGCTCGATCCCGATATCCGCGCCTATCTCGAAGCCGAGAACGGCTACACCGACAGCGTGCTCGGCCACACCGAGGCG TTGCAGAAGACGCTGGTTGCGGAAATGCGCGGGCGGATCAAGGAAGACGATTCCAGCGTGCCGCAGCCGGACGGGCCCTA CGCTTACTTGCGCAAATTCCGCGAAGGCGGCCAGCATCCGCTGTATGGCCGCACGCCGCGCGACGGCGGCGAACTCGACA TCATCCTCGACGGCGACGAACTGGCGAAGGGCACCGAGTACTTCCAGTTCGGCGGACGGCGGCATTCGCTCGACCACAAG CTGGAAGCCTGGAGCGCTGACGCCAAGGGCTCGGAATACTACACCATCCGCGTGCGCGACTGGACGACGAAGCAGGATTT GCCCGACCTCGTCGAGGAGACCGACGGCGGCGTGGTCTGGACCGCGGACTCGAGCGCGTTCTTCTACGTCAAGCTCGACG ACAATCATCGGCCGATGCAGATCTGGCTGCACAAGCTCGGCACCGCGCAGGCCGACGACCTGCTGGTGTACGAGGAGAAA GACGCCGGCTGGTTCACCCACATCCACGAGAGCAGCAGCGGACGGTTCTGCGTGATCGCCGGCGGCGACCACGAGACGTC GGAGCAGCGGCTGATCGACGTCTCCGATCCGACCGCGCCGCCGCGGCTCGTCGCCGCGCGCGAACTCGGCGTGCAATATT CGCTCGCAGATCGCGGCGACGAGCTGTTCATCCTCACCAATGCGGACGGCGCGATCGACTTCAAGATCGTCACCGCGCCG CTGGCTTCGCCTGTGCGCGACAATTGGCGCGATCTGATCCCGCATCGCGAAGGCATCTATATCATCGACTTCGACCTGTT CTCCGGCCACATGATGCGGCTGGAGCGCGCCAACGCGCTGCCGTCGGTGACGATCCGCGATCTCGCGAGCGGCGATGAGC ATGCCATCGCCTTCGACGAGGCGGCCTACTCGCTGTCCGCCTCCGGCGGCTGGGAATTCGACACCACGGTGATGCGGTTC TCCTACTCGTCGATGACGACGCCGTCGGAAGTCTACGATTACGACATGGCGACGCGCGAGCGGAGCTTGCGCAAGCGCCA GGAAATTCCCTCGGGCCAAAATCCGGCAGACTACGTCACCACCCGGATCATGGCGAAGGCCGACGACGGCGCCGAGGTGC CGGTGTCGCTGCTGCATCGCAAGGGGCTCGCGCTCGACGGCGCGGCGCCGCTGCTTCTGTACGGCTACGGCTCCTACGGC CACGCGATGCCGGCGGGCTTCTCCGCCAACGCGCTGTCGCTGGTCGATCGCGGCTTCGTTTACGCGATCGCGCATATCCG CGGCGGCGCCGACAAGGGCTGGGGCTGGTATCTCGACGGCAAGCGCGAGAAGAAGACCAACTCGTTCGACGATTTCGCCG CCTGCGCGCAGGCGTTGATCGACGCCAAGTACACGTCGGCGAAACGCATTGTCGCCCATGGCGGCAGTGCCGGCGGCATG CTGATGGGCGCGGTCGCCAACCGCTCGGGCGAGTTGTTCGCCGGCATCGTCGCCGAAGTGCCGTTCGTCGACGTGCTCAA CACCATGCTCGACGATACGCTGCCGCTGACGCCGCCGGAATGGCCTGAATGGGGAAATCCGATCAGCAGCGAAGCCGACT TCAAAACCATCCTGTCCTACTCGCCCTACGACAACGTCGCGGCGACGACCTATCCGGCCATCCTCGCGATGGGCGGCCTC ACCGATCCGCGCGTCACCTATTGGGAGCCGGCGAAATGGGTGGCGCGGCTGCGCGCGACCATGACCGGCGGCGGCCCCGT GCTGCTCCGCATCAACATGGGCGCCGGCCACGGCGGCGCGTCCGGCCGGTTCAGCCGGCTCGACGAGGTCGCGATCGTCT ACGCCTTCGCCTTGTGGGCGGTCGGCCTCGCGGATTCCGCTGCCTGA
Upstream 100 bases:
>100_bases ACATGCTGTCTCTGGCGGAAGCCGGAACCGGCCGCGGCCTATCGACATCAATCCGGCGCGCGCCGCAAGCGCCAAACTCT GCTAAGCCAACCGCATCCGC
Downstream 100 bases:
>100_bases ACTTCGCCACCAGTTTGCCGCAACCCTCCTTCAGCCGCAGAGATGCTCATGGCCGCTCCAAAACCGCCCGGATTCGAGAC ACTTAGCCTGCACGCCGGGC
Product: oligopeptidase B
Products: NA
Alternate protein names: Oligopeptidase B; Protease II [H]
Number of amino acids: Translated: 708; Mature: 708
Protein sequence:
>708_residues MQRDPLMTLSPPRDATPPVAPRRPHAFTTHGITINDDYAWLKDPNWQEVLRDPALLDPDIRAYLEAENGYTDSVLGHTEA LQKTLVAEMRGRIKEDDSSVPQPDGPYAYLRKFREGGQHPLYGRTPRDGGELDIILDGDELAKGTEYFQFGGRRHSLDHK LEAWSADAKGSEYYTIRVRDWTTKQDLPDLVEETDGGVVWTADSSAFFYVKLDDNHRPMQIWLHKLGTAQADDLLVYEEK DAGWFTHIHESSSGRFCVIAGGDHETSEQRLIDVSDPTAPPRLVAARELGVQYSLADRGDELFILTNADGAIDFKIVTAP LASPVRDNWRDLIPHREGIYIIDFDLFSGHMMRLERANALPSVTIRDLASGDEHAIAFDEAAYSLSASGGWEFDTTVMRF SYSSMTTPSEVYDYDMATRERSLRKRQEIPSGQNPADYVTTRIMAKADDGAEVPVSLLHRKGLALDGAAPLLLYGYGSYG HAMPAGFSANALSLVDRGFVYAIAHIRGGADKGWGWYLDGKREKKTNSFDDFAACAQALIDAKYTSAKRIVAHGGSAGGM LMGAVANRSGELFAGIVAEVPFVDVLNTMLDDTLPLTPPEWPEWGNPISSEADFKTILSYSPYDNVAATTYPAILAMGGL TDPRVTYWEPAKWVARLRATMTGGGPVLLRINMGAGHGGASGRFSRLDEVAIVYAFALWAVGLADSAA
Sequences:
>Translated_708_residues MQRDPLMTLSPPRDATPPVAPRRPHAFTTHGITINDDYAWLKDPNWQEVLRDPALLDPDIRAYLEAENGYTDSVLGHTEA LQKTLVAEMRGRIKEDDSSVPQPDGPYAYLRKFREGGQHPLYGRTPRDGGELDIILDGDELAKGTEYFQFGGRRHSLDHK LEAWSADAKGSEYYTIRVRDWTTKQDLPDLVEETDGGVVWTADSSAFFYVKLDDNHRPMQIWLHKLGTAQADDLLVYEEK DAGWFTHIHESSSGRFCVIAGGDHETSEQRLIDVSDPTAPPRLVAARELGVQYSLADRGDELFILTNADGAIDFKIVTAP LASPVRDNWRDLIPHREGIYIIDFDLFSGHMMRLERANALPSVTIRDLASGDEHAIAFDEAAYSLSASGGWEFDTTVMRF SYSSMTTPSEVYDYDMATRERSLRKRQEIPSGQNPADYVTTRIMAKADDGAEVPVSLLHRKGLALDGAAPLLLYGYGSYG HAMPAGFSANALSLVDRGFVYAIAHIRGGADKGWGWYLDGKREKKTNSFDDFAACAQALIDAKYTSAKRIVAHGGSAGGM LMGAVANRSGELFAGIVAEVPFVDVLNTMLDDTLPLTPPEWPEWGNPISSEADFKTILSYSPYDNVAATTYPAILAMGGL TDPRVTYWEPAKWVARLRATMTGGGPVLLRINMGAGHGGASGRFSRLDEVAIVYAFALWAVGLADSAA >Mature_708_residues MQRDPLMTLSPPRDATPPVAPRRPHAFTTHGITINDDYAWLKDPNWQEVLRDPALLDPDIRAYLEAENGYTDSVLGHTEA LQKTLVAEMRGRIKEDDSSVPQPDGPYAYLRKFREGGQHPLYGRTPRDGGELDIILDGDELAKGTEYFQFGGRRHSLDHK LEAWSADAKGSEYYTIRVRDWTTKQDLPDLVEETDGGVVWTADSSAFFYVKLDDNHRPMQIWLHKLGTAQADDLLVYEEK DAGWFTHIHESSSGRFCVIAGGDHETSEQRLIDVSDPTAPPRLVAARELGVQYSLADRGDELFILTNADGAIDFKIVTAP LASPVRDNWRDLIPHREGIYIIDFDLFSGHMMRLERANALPSVTIRDLASGDEHAIAFDEAAYSLSASGGWEFDTTVMRF SYSSMTTPSEVYDYDMATRERSLRKRQEIPSGQNPADYVTTRIMAKADDGAEVPVSLLHRKGLALDGAAPLLLYGYGSYG HAMPAGFSANALSLVDRGFVYAIAHIRGGADKGWGWYLDGKREKKTNSFDDFAACAQALIDAKYTSAKRIVAHGGSAGGM LMGAVANRSGELFAGIVAEVPFVDVLNTMLDDTLPLTPPEWPEWGNPISSEADFKTILSYSPYDNVAATTYPAILAMGGL TDPRVTYWEPAKWVARLRATMTGGGPVLLRINMGAGHGGASGRFSRLDEVAIVYAFALWAVGLADSAA
Specific function: Cleaves peptide bonds on the C-terminal side of lysyl and argininyl residues [H]
COG id: COG1770
COG function: function code E; Protease II
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the peptidase S9A family [H]
Homologues:
Organism=Homo sapiens, GI41349456, Length=709, Percent_Identity=26.0930888575458, Blast_Score=207, Evalue=2e-53, Organism=Homo sapiens, GI284172438, Length=492, Percent_Identity=31.5040650406504, Blast_Score=207, Evalue=2e-53, Organism=Homo sapiens, GI284172431, Length=492, Percent_Identity=31.5040650406504, Blast_Score=207, Evalue=2e-53, Organism=Homo sapiens, GI284172420, Length=492, Percent_Identity=31.5040650406504, Blast_Score=207, Evalue=2e-53, Organism=Homo sapiens, GI284172413, Length=492, Percent_Identity=31.5040650406504, Blast_Score=207, Evalue=2e-53, Organism=Homo sapiens, GI70778815, Length=492, Percent_Identity=31.5040650406504, Blast_Score=207, Evalue=2e-53, Organism=Homo sapiens, GI108860692, Length=485, Percent_Identity=29.2783505154639, Blast_Score=169, Evalue=1e-41, Organism=Homo sapiens, GI108860686, Length=288, Percent_Identity=34.375, Blast_Score=144, Evalue=4e-34, Organism=Escherichia coli, GI1788150, Length=685, Percent_Identity=38.978102189781, Blast_Score=461, Evalue=1e-131, Organism=Drosophila melanogaster, GI24583414, Length=710, Percent_Identity=26.3380281690141, Blast_Score=205, Evalue=1e-52, Organism=Drosophila melanogaster, GI221510989, Length=712, Percent_Identity=24.1573033707865, Blast_Score=177, Evalue=3e-44,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR002471 - InterPro: IPR001375 - InterPro: IPR002470 - InterPro: IPR004106 [H]
Pfam domain/function: PF00326 Peptidase_S9; PF02897 Peptidase_S9_N [H]
EC number: =3.4.21.83 [H]
Molecular weight: Translated: 77882; Mature: 77882
Theoretical pI: Translated: 4.80; Mature: 4.80
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.3 %Cys (Translated Protein) 2.4 %Met (Translated Protein) 2.7 %Cys+Met (Translated Protein) 0.3 %Cys (Mature Protein) 2.4 %Met (Mature Protein) 2.7 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MQRDPLMTLSPPRDATPPVAPRRPHAFTTHGITINDDYAWLKDPNWQEVLRDPALLDPDI CCCCCCEEECCCCCCCCCCCCCCCCCEEECCEEECCCCCCCCCCCHHHHHCCCCCCCCCC RAYLEAENGYTDSVLGHTEALQKTLVAEMRGRIKEDDSSVPQPDGPYAYLRKFREGGQHP EEEEECCCCCCHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCHHHHHHHHHCCCCC LYGRTPRDGGELDIILDGDELAKGTEYFQFGGRRHSLDHKLEAWSADAKGSEYYTIRVRD CCCCCCCCCCCEEEEECCHHHCCCCHHHHCCCCCCCCCHHHHHCCCCCCCCEEEEEEEEC WTTKQDLPDLVEETDGGVVWTADSSAFFYVKLDDNHRPMQIWLHKLGTAQADDLLVYEEK CCCCCCCHHHHHHCCCCEEEEECCCEEEEEEECCCCCHHHHHHHHHCCCCCCCEEEEEEC DAGWFTHIHESSSGRFCVIAGGDHETSEQRLIDVSDPTAPPRLVAARELGVQYSLADRGD CCCEEEEEEECCCCCEEEEECCCCCCCCCEEEECCCCCCCCHHHHHHHHCCEEEECCCCC ELFILTNADGAIDFKIVTAPLASPVRDNWRDLIPHREGIYIIDFDLFSGHMMRLERANAL EEEEEECCCCEEEEEEEECCCCCCHHHHHHHHCCCCCCEEEEEECCCCCHHHHHHHHCCC PSVTIRDLASGDEHAIAFDEAAYSLSASGGWEFDTTVMRFSYSSMTTPSEVYDYDMATRE CCEEHHHHCCCCCCEEEECCHHEEEECCCCCCCCCEEEEEECCCCCCCHHHHHHHHHHHH RSLRKRQEIPSGQNPADYVTTRIMAKADDGAEVPVSLLHRKGLALDGAAPLLLYGYGSYG HHHHHHHCCCCCCCCHHHHHHEEEEECCCCCCCCHHHHHHCCCEECCCCCEEEEECCCCC HAMPAGFSANALSLVDRGFVYAIAHIRGGADKGWGWYLDGKREKKTNSFDDFAACAQALI CCCCCCCCCCHHHHHHCCCEEEEEECCCCCCCCCEEEECCCCCCCCCCHHHHHHHHHHHH DAKYTSAKRIVAHGGSAGGMLMGAVANRSGELFAGIVAEVPFVDVLNTMLDDTLPLTPPE HHHHCCCCCCEECCCCCCCEEEEEHHCCCCCEEEHHHHHCCHHHHHHHHHHCCCCCCCCC WPEWGNPISSEADFKTILSYSPYDNVAATTYPAILAMGGLTDPRVTYWEPAKWVARLRAT CCCCCCCCCCCCCHHHHEECCCCCCCHHHHHHHHHHCCCCCCCCEEEECHHHHHHHHHHH MTGGGPVLLRINMGAGHGGASGRFSRLDEVAIVYAFALWAVGLADSAA CCCCCEEEEEEECCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCC >Mature Secondary Structure MQRDPLMTLSPPRDATPPVAPRRPHAFTTHGITINDDYAWLKDPNWQEVLRDPALLDPDI CCCCCCEEECCCCCCCCCCCCCCCCCEEECCEEECCCCCCCCCCCHHHHHCCCCCCCCCC RAYLEAENGYTDSVLGHTEALQKTLVAEMRGRIKEDDSSVPQPDGPYAYLRKFREGGQHP EEEEECCCCCCHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCHHHHHHHHHCCCCC LYGRTPRDGGELDIILDGDELAKGTEYFQFGGRRHSLDHKLEAWSADAKGSEYYTIRVRD CCCCCCCCCCCEEEEECCHHHCCCCHHHHCCCCCCCCCHHHHHCCCCCCCCEEEEEEEEC WTTKQDLPDLVEETDGGVVWTADSSAFFYVKLDDNHRPMQIWLHKLGTAQADDLLVYEEK CCCCCCCHHHHHHCCCCEEEEECCCEEEEEEECCCCCHHHHHHHHHCCCCCCCEEEEEEC DAGWFTHIHESSSGRFCVIAGGDHETSEQRLIDVSDPTAPPRLVAARELGVQYSLADRGD CCCEEEEEEECCCCCEEEEECCCCCCCCCEEEECCCCCCCCHHHHHHHHCCEEEECCCCC ELFILTNADGAIDFKIVTAPLASPVRDNWRDLIPHREGIYIIDFDLFSGHMMRLERANAL EEEEEECCCCEEEEEEEECCCCCCHHHHHHHHCCCCCCEEEEEECCCCCHHHHHHHHCCC PSVTIRDLASGDEHAIAFDEAAYSLSASGGWEFDTTVMRFSYSSMTTPSEVYDYDMATRE CCEEHHHHCCCCCCEEEECCHHEEEECCCCCCCCCEEEEEECCCCCCCHHHHHHHHHHHH RSLRKRQEIPSGQNPADYVTTRIMAKADDGAEVPVSLLHRKGLALDGAAPLLLYGYGSYG HHHHHHHCCCCCCCCHHHHHHEEEEECCCCCCCCHHHHHHCCCEECCCCCEEEEECCCCC HAMPAGFSANALSLVDRGFVYAIAHIRGGADKGWGWYLDGKREKKTNSFDDFAACAQALI CCCCCCCCCCHHHHHHCCCEEEEEECCCCCCCCCEEEECCCCCCCCCCHHHHHHHHHHHH DAKYTSAKRIVAHGGSAGGMLMGAVANRSGELFAGIVAEVPFVDVLNTMLDDTLPLTPPE HHHHCCCCCCEECCCCCCCEEEEEHHCCCCCEEEHHHHHCCHHHHHHHHHHCCCCCCCCC WPEWGNPISSEADFKTILSYSPYDNVAATTYPAILAMGGLTDPRVTYWEPAKWVARLRAT CCCCCCCCCCCCCHHHHEECCCCCCCHHHHHHHHHHCCCCCCCCEEEECHHHHHHHHHHH MTGGGPVLLRINMGAGHGGASGRFSRLDEVAIVYAFALWAVGLADSAA CCCCCEEEEEEECCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 1769955; 9097040; 9278503 [H]