Definition Xanthobacter autotrophicus Py2 chromosome, complete genome.
Accession NC_009720
Length 5,308,934

Click here to switch to the map view.

The map label for this gene is ptrB [H]

Identifier: 154246778

GI number: 154246778

Start: 3168083

End: 3170179

Strand: Reverse

Name: ptrB [H]

Synonym: Xaut_2839

Alternate gene names: 154246778

Gene position: 3170179-3168083 (Counterclockwise)

Preceding gene: 154246779

Following gene: 154246777

Centisome position: 59.71

GC content: 68.43

Gene sequence:

>2097_bases
GTGGCGCCTGAGCCGCCGCGCGCGCCACGGCGACCGAGTGAGCGCACTGTCCACGGCGTGACCCTCTCCGACGACTATGC
TTGGCTGCGCGCCGAAAACTGGCGCGCCGTCATGCGAGATCCGTCCGTGCTGGACGCCGACATCCGCGCCTATCTGGAGG
CGGAGAACACCTTCGCCGAGGCCTATTTCGCCCCCATGGGCGAGGCCAAGGCCGCCCTCGTCGCCGAGATGCGCGGGCGC
ATCAAGGAGGATGATTCCTCCGTTCCCGCCCCGGACGGGCCGTTTGCCTATTTCTCCCGGCACCGGGAGGGCGGCCAGCA
TCCGCTCTATTGCCGCAAGCCGCTGCCCGATGGCCCCGAGGCCATCCTGCTCGATGGCGACAAGGAGGCCGAAGGCAAGG
CCTATTTCCATTTCGGCCACTGGCGCCACACCCGTGACCACGCCTTGTTCGCCTTCGCGGCGGACACCTCGGGCTCGGAG
CTGTACGCCATCCGCATCCGCGACCTGTCGAGCGGCGCCGACCTGCCCGACGTGATCGAGGAAACCACCGGCGACCTGCT
CTGGAGCGCGGACGGAACCGTTCTTTATTACATCCGCCGCGATGCCGAGCACCGGCCGTCGAAGGTGTTCCGCCACGTCC
TGGGGACCGATCCGGCCGCCGACACCCTCATTTATGAGGAACCGGACAAGGGCTTCTTCGTCTCGCTGGGCGAGACACAG
TCCCACCGCTACGGCCTCATCGCCTGCGGCGACCACGACACCTCGGAGGTCCACCTTTTGGACCTCACCGAAGCTGCGCC
CCAGCCCCGCTGCATCGCCCCGCGCGAGGCCGGCGTGCGTTACGAGGTGGAGCACCACCCAAGCCTCGCCGGCACCGACA
GCCTGATCCTCCTCACCAACGCCGACGGGGCGGAGGATTTCAAGATCGTCACCGCTCCCACGGGCACTCCGGACCGCGCC
CACTGGCGCGACCTGGTGCCCCACCGGGCCGGGCGGATGATCCTGAGCCACACCGTCTTCGCCGGCCACATGGCCCGGCT
GGAGCGGGAGGCGGGGCTGCCGCGCATCATCATCCGGGAGCTGGCCTCGGGCGACGAGCACGCCATCGCCTTCGACGAGG
AGGCCTATGCGCTGGGGCTTCACCCCGGCTTCGGCTTCGACACCAGCGCGGTCCGCTTCACCTACGCCTCCATGACCACG
CCGTCCGAGGTGTGGGACTATGACATGGCGACCCGCCGCCGGGAGATGCTGAAGCGCCAGGAAGTCCCCTCCGGCCACGA
CCCGGCCGACTACGTGACCCGGCGCCTTTATGCCGTCGCGCCGGACGGGGAGAGCGTTCCAGTCTCCCTGCTCTATCGCA
AAGGAACCCCGCTGGACGGCTCCGCGCCCCTCCTGCTTTATGGATATGGTGCCTACGGCATCACCATTCCGGCCGGCTTC
TCCACCAGCCGCCTGTCGCTGGTGGATCGCGGCTTCATCTATGCCATCGCCCATGTGCGCGGCGGCACGGACAAGGGCTG
GCGCTGGTACGCCGACGGCAAGCTTGCGGGGAAGACCAACACCTTCACCGATTTCATCGCCTGCGCCGAGCATCTGGTGG
CCGAGGGTTTCACCAAGCCGGACCGCATCGTCGCACAGGGCGGCTCGGCGGGCGGCATGCTGATGGGGGCGGTGGCGAAC
CTGCGGCCGGACATGTTCGCCGGCATCGTGGCCGAGGTCCCGTTCGTGGACGTGCTCACCACCATGCTGGACGACACCCT
GCCCCTGACCCCGCCCGAATGGCCTGAATGGGGCAATCCCATCACCGACGAGGCGGCGTTCCGACGCATCCTGGCCTATT
CGCCCGTGGATAACGTGCGCCCGCAGGCCTACCCGTCCATCTTCGCCCTCGCCGGGCTGACCGATCCCCGCGTGACCTAT
TGGGAGCCGGCGAAATGGGTGGCGCGGCTGCGCGCCGCGGACACCGAGGGGCGGACAATCCTGCTGCGCACCAACATGGA
TGCGGGACATGGCGGCGCCGCCGGACGATTCGACAAGCTGGACGAGGTTGCGCTCGTCTATCTGTTCGCCTTGAAGACGG
TGGGCCGCACAACCTGA

Upstream 100 bases:

>100_bases
CATCTGGGCCACGTCTTCCCGGATGGACCGGCCCCCACCGGCCTGCGCTTCTGCCTGAACGGCACCGCCCTCAAGCTTGC
GCCCGACGACGGAGATACCC

Downstream 100 bases:

>100_bases
GGACGCCGGGGCACGGCGCCGGCCCGGATCATGCGACGATCCGGGCGGCAAAGCGGCCTCTTTCCTTGATGTTGGCGGAA
CGTTCAGCGGTCTGGCCGGA

Product: oligopeptidase B

Products: NA

Alternate protein names: Oligopeptidase B; Protease II [H]

Number of amino acids: Translated: 698; Mature: 697

Protein sequence:

>698_residues
MAPEPPRAPRRPSERTVHGVTLSDDYAWLRAENWRAVMRDPSVLDADIRAYLEAENTFAEAYFAPMGEAKAALVAEMRGR
IKEDDSSVPAPDGPFAYFSRHREGGQHPLYCRKPLPDGPEAILLDGDKEAEGKAYFHFGHWRHTRDHALFAFAADTSGSE
LYAIRIRDLSSGADLPDVIEETTGDLLWSADGTVLYYIRRDAEHRPSKVFRHVLGTDPAADTLIYEEPDKGFFVSLGETQ
SHRYGLIACGDHDTSEVHLLDLTEAAPQPRCIAPREAGVRYEVEHHPSLAGTDSLILLTNADGAEDFKIVTAPTGTPDRA
HWRDLVPHRAGRMILSHTVFAGHMARLEREAGLPRIIIRELASGDEHAIAFDEEAYALGLHPGFGFDTSAVRFTYASMTT
PSEVWDYDMATRRREMLKRQEVPSGHDPADYVTRRLYAVAPDGESVPVSLLYRKGTPLDGSAPLLLYGYGAYGITIPAGF
STSRLSLVDRGFIYAIAHVRGGTDKGWRWYADGKLAGKTNTFTDFIACAEHLVAEGFTKPDRIVAQGGSAGGMLMGAVAN
LRPDMFAGIVAEVPFVDVLTTMLDDTLPLTPPEWPEWGNPITDEAAFRRILAYSPVDNVRPQAYPSIFALAGLTDPRVTY
WEPAKWVARLRAADTEGRTILLRTNMDAGHGGAAGRFDKLDEVALVYLFALKTVGRTT

Sequences:

>Translated_698_residues
MAPEPPRAPRRPSERTVHGVTLSDDYAWLRAENWRAVMRDPSVLDADIRAYLEAENTFAEAYFAPMGEAKAALVAEMRGR
IKEDDSSVPAPDGPFAYFSRHREGGQHPLYCRKPLPDGPEAILLDGDKEAEGKAYFHFGHWRHTRDHALFAFAADTSGSE
LYAIRIRDLSSGADLPDVIEETTGDLLWSADGTVLYYIRRDAEHRPSKVFRHVLGTDPAADTLIYEEPDKGFFVSLGETQ
SHRYGLIACGDHDTSEVHLLDLTEAAPQPRCIAPREAGVRYEVEHHPSLAGTDSLILLTNADGAEDFKIVTAPTGTPDRA
HWRDLVPHRAGRMILSHTVFAGHMARLEREAGLPRIIIRELASGDEHAIAFDEEAYALGLHPGFGFDTSAVRFTYASMTT
PSEVWDYDMATRRREMLKRQEVPSGHDPADYVTRRLYAVAPDGESVPVSLLYRKGTPLDGSAPLLLYGYGAYGITIPAGF
STSRLSLVDRGFIYAIAHVRGGTDKGWRWYADGKLAGKTNTFTDFIACAEHLVAEGFTKPDRIVAQGGSAGGMLMGAVAN
LRPDMFAGIVAEVPFVDVLTTMLDDTLPLTPPEWPEWGNPITDEAAFRRILAYSPVDNVRPQAYPSIFALAGLTDPRVTY
WEPAKWVARLRAADTEGRTILLRTNMDAGHGGAAGRFDKLDEVALVYLFALKTVGRTT
>Mature_697_residues
APEPPRAPRRPSERTVHGVTLSDDYAWLRAENWRAVMRDPSVLDADIRAYLEAENTFAEAYFAPMGEAKAALVAEMRGRI
KEDDSSVPAPDGPFAYFSRHREGGQHPLYCRKPLPDGPEAILLDGDKEAEGKAYFHFGHWRHTRDHALFAFAADTSGSEL
YAIRIRDLSSGADLPDVIEETTGDLLWSADGTVLYYIRRDAEHRPSKVFRHVLGTDPAADTLIYEEPDKGFFVSLGETQS
HRYGLIACGDHDTSEVHLLDLTEAAPQPRCIAPREAGVRYEVEHHPSLAGTDSLILLTNADGAEDFKIVTAPTGTPDRAH
WRDLVPHRAGRMILSHTVFAGHMARLEREAGLPRIIIRELASGDEHAIAFDEEAYALGLHPGFGFDTSAVRFTYASMTTP
SEVWDYDMATRRREMLKRQEVPSGHDPADYVTRRLYAVAPDGESVPVSLLYRKGTPLDGSAPLLLYGYGAYGITIPAGFS
TSRLSLVDRGFIYAIAHVRGGTDKGWRWYADGKLAGKTNTFTDFIACAEHLVAEGFTKPDRIVAQGGSAGGMLMGAVANL
RPDMFAGIVAEVPFVDVLTTMLDDTLPLTPPEWPEWGNPITDEAAFRRILAYSPVDNVRPQAYPSIFALAGLTDPRVTYW
EPAKWVARLRAADTEGRTILLRTNMDAGHGGAAGRFDKLDEVALVYLFALKTVGRTT

Specific function: Cleaves peptide bonds on the C-terminal side of lysyl and argininyl residues [H]

COG id: COG1770

COG function: function code E; Protease II

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the peptidase S9A family [H]

Homologues:

Organism=Homo sapiens, GI284172420, Length=476, Percent_Identity=33.1932773109244, Blast_Score=211, Evalue=2e-54,
Organism=Homo sapiens, GI284172413, Length=476, Percent_Identity=33.1932773109244, Blast_Score=211, Evalue=2e-54,
Organism=Homo sapiens, GI70778815, Length=476, Percent_Identity=33.1932773109244, Blast_Score=211, Evalue=2e-54,
Organism=Homo sapiens, GI284172438, Length=476, Percent_Identity=33.1932773109244, Blast_Score=211, Evalue=2e-54,
Organism=Homo sapiens, GI284172431, Length=476, Percent_Identity=33.1932773109244, Blast_Score=211, Evalue=2e-54,
Organism=Homo sapiens, GI41349456, Length=714, Percent_Identity=25.7703081232493, Blast_Score=208, Evalue=1e-53,
Organism=Homo sapiens, GI108860686, Length=280, Percent_Identity=37.5, Blast_Score=166, Evalue=8e-41,
Organism=Homo sapiens, GI108860692, Length=215, Percent_Identity=40.9302325581395, Blast_Score=159, Evalue=1e-38,
Organism=Escherichia coli, GI1788150, Length=690, Percent_Identity=38.5507246376812, Blast_Score=462, Evalue=1e-131,
Organism=Drosophila melanogaster, GI221510989, Length=737, Percent_Identity=24.0162822252374, Blast_Score=199, Evalue=8e-51,
Organism=Drosophila melanogaster, GI24583414, Length=710, Percent_Identity=24.0845070422535, Blast_Score=184, Evalue=2e-46,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR002471
- InterPro:   IPR001375
- InterPro:   IPR002470
- InterPro:   IPR004106 [H]

Pfam domain/function: PF00326 Peptidase_S9; PF02897 Peptidase_S9_N [H]

EC number: =3.4.21.83 [H]

Molecular weight: Translated: 76951; Mature: 76820

Theoretical pI: Translated: 5.41; Mature: 5.41

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.6 %Cys     (Translated Protein)
2.0 %Met     (Translated Protein)
2.6 %Cys+Met (Translated Protein)
0.6 %Cys     (Mature Protein)
1.9 %Met     (Mature Protein)
2.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MAPEPPRAPRRPSERTVHGVTLSDDYAWLRAENWRAVMRDPSVLDADIRAYLEAENTFAE
CCCCCCCCCCCCCCCEEEEEEECCCCEEEEECCCCEECCCCCHHHHHHHHHHHHCHHHHH
AYFAPMGEAKAALVAEMRGRIKEDDSSVPAPDGPFAYFSRHREGGQHPLYCRKPLPDGPE
HHHCCCCCHHHHHHHHHHCCCCCCCCCCCCCCCCHHHHHHHCCCCCCCEEECCCCCCCCC
AILLDGDKEAEGKAYFHFGHWRHTRDHALFAFAADTSGSELYAIRIRDLSSGADLPDVIE
EEEEECCCCCCCCEEEEECCCCCCCCCEEEEEEECCCCCEEEEEEEEECCCCCCCHHHHH
ETTGDLLWSADGTVLYYIRRDAEHRPSKVFRHVLGTDPAADTLIYEEPDKGFFVSLGETQ
HCCCCEEEECCCEEEEEEECCCCCCHHHHHHHHHCCCCCCCCEEEECCCCCEEEEECCCC
SHRYGLIACGDHDTSEVHLLDLTEAAPQPRCIAPREAGVRYEVEHHPSLAGTDSLILLTN
CCCEEEEEECCCCCCCEEEEEECCCCCCCCEECCCCCCCEEEECCCCCCCCCCCEEEEEC
ADGAEDFKIVTAPTGTPDRAHWRDLVPHRAGRMILSHTVFAGHMARLEREAGLPRIIIRE
CCCCCCEEEEECCCCCCCHHHHHHHCHHHHCCHHHHHHHHHHHHHHHHHHCCCHHHHHHH
LASGDEHAIAFDEEAYALGLHPGFGFDTSAVRFTYASMTTPSEVWDYDMATRRREMLKRQ
HCCCCCCEEEECCCCEEEECCCCCCCCCCEEEEEEECCCCCHHHHCCHHHHHHHHHHHHH
EVPSGHDPADYVTRRLYAVAPDGESVPVSLLYRKGTPLDGSAPLLLYGYGAYGITIPAGF
CCCCCCCCHHHHHHEEEEECCCCCCCCEEEEEECCCCCCCCCCEEEEEECCCEEEEECCC
STSRLSLVDRGFIYAIAHVRGGTDKGWRWYADGKLAGKTNTFTDFIACAEHLVAEGFTKP
CCCHHHHHHCCEEEEEEEECCCCCCCEEEEECCEECCCCCHHHHHHHHHHHHHHCCCCCC
DRIVAQGGSAGGMLMGAVANLRPDMFAGIVAEVPFVDVLTTMLDDTLPLTPPEWPEWGNP
CCEEECCCCCCCHHHHHHHHCCHHHHHHHHHHCCHHHHHHHHHCCCCCCCCCCCCCCCCC
ITDEAAFRRILAYSPVDNVRPQAYPSIFALAGLTDPRVTYWEPAKWVARLRAADTEGRTI
CCHHHHHHHHHHCCCCCCCCCCCCCCEEEEECCCCCCCEEECHHHHHHHHHCCCCCCCEE
LLRTNMDAGHGGAAGRFDKLDEVALVYLFALKTVGRTT
EEEECCCCCCCCCCCCCCHHHHHHHHHHHHHHHHCCCC
>Mature Secondary Structure 
APEPPRAPRRPSERTVHGVTLSDDYAWLRAENWRAVMRDPSVLDADIRAYLEAENTFAE
CCCCCCCCCCCCCCEEEEEEECCCCEEEEECCCCEECCCCCHHHHHHHHHHHHCHHHHH
AYFAPMGEAKAALVAEMRGRIKEDDSSVPAPDGPFAYFSRHREGGQHPLYCRKPLPDGPE
HHHCCCCCHHHHHHHHHHCCCCCCCCCCCCCCCCHHHHHHHCCCCCCCEEECCCCCCCCC
AILLDGDKEAEGKAYFHFGHWRHTRDHALFAFAADTSGSELYAIRIRDLSSGADLPDVIE
EEEEECCCCCCCCEEEEECCCCCCCCCEEEEEEECCCCCEEEEEEEEECCCCCCCHHHHH
ETTGDLLWSADGTVLYYIRRDAEHRPSKVFRHVLGTDPAADTLIYEEPDKGFFVSLGETQ
HCCCCEEEECCCEEEEEEECCCCCCHHHHHHHHHCCCCCCCCEEEECCCCCEEEEECCCC
SHRYGLIACGDHDTSEVHLLDLTEAAPQPRCIAPREAGVRYEVEHHPSLAGTDSLILLTN
CCCEEEEEECCCCCCCEEEEEECCCCCCCCEECCCCCCCEEEECCCCCCCCCCCEEEEEC
ADGAEDFKIVTAPTGTPDRAHWRDLVPHRAGRMILSHTVFAGHMARLEREAGLPRIIIRE
CCCCCCEEEEECCCCCCCHHHHHHHCHHHHCCHHHHHHHHHHHHHHHHHHCCCHHHHHHH
LASGDEHAIAFDEEAYALGLHPGFGFDTSAVRFTYASMTTPSEVWDYDMATRRREMLKRQ
HCCCCCCEEEECCCCEEEECCCCCCCCCCEEEEEEECCCCCHHHHCCHHHHHHHHHHHHH
EVPSGHDPADYVTRRLYAVAPDGESVPVSLLYRKGTPLDGSAPLLLYGYGAYGITIPAGF
CCCCCCCCHHHHHHEEEEECCCCCCCCEEEEEECCCCCCCCCCEEEEEECCCEEEEECCC
STSRLSLVDRGFIYAIAHVRGGTDKGWRWYADGKLAGKTNTFTDFIACAEHLVAEGFTKP
CCCHHHHHHCCEEEEEEEECCCCCCCEEEEECCEECCCCCHHHHHHHHHHHHHHCCCCCC
DRIVAQGGSAGGMLMGAVANLRPDMFAGIVAEVPFVDVLTTMLDDTLPLTPPEWPEWGNP
CCEEECCCCCCCHHHHHHHHCCHHHHHHHHHHCCHHHHHHHHHCCCCCCCCCCCCCCCCC
ITDEAAFRRILAYSPVDNVRPQAYPSIFALAGLTDPRVTYWEPAKWVARLRAADTEGRTI
CCHHHHHHHHHHCCCCCCCCCCCCCCEEEEECCCCCCCEEECHHHHHHHHHCCCCCCCEE
LLRTNMDAGHGGAAGRFDKLDEVALVYLFALKTVGRTT
EEEECCCCCCCCCCCCCCHHHHHHHHHHHHHHHHCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 1769955; 9097040; 9278503 [H]