| Definition | Phenylobacterium zucineum HLK1, complete genome. |
|---|---|
| Accession | NC_011144 |
| Length | 3,996,255 |
Click here to switch to the map view.
The map label for this gene is ptrB [H]
Identifier: 197104537
GI number: 197104537
Start: 1208002
End: 1210125
Strand: Direct
Name: ptrB [H]
Synonym: PHZ_c1071
Alternate gene names: 197104537
Gene position: 1208002-1210125 (Clockwise)
Preceding gene: 197104529
Following gene: 197104539
Centisome position: 30.23
GC content: 69.16
Gene sequence:
>2124_bases ATGCGCATCGCAACCTTCGCCGCCGCGGCGGCCGTCCTGCTGGCCGGCGCGGCCCAGGCCCAGGCCCAGACTCAGCCCAC GACGCCGGAGCCGCCGCGGGCGGCCAAGCGCCCCCACGAGGTGAAGGCGCCGGGCGGGACCCGGACGGACGAATACTACT GGCTGCGCGACGACACCCGGAAGAACCCGGAGATGCTGGCCCACCTGGCCGCCGAGAACGCCTACGCCGACGCGGTGCTG GCGGCGAACAAGCCGCTGAAGGAAGCGCTCTACAAGGAGATCGTCGGGCGGGTGAAGCAGGACGATGCGTCCGTGCCGTA CCGCGAGCGGGGCTACTGGTACTACACGCGCTTCGAGGCCGGGAAGGACTACCCGATCCTCGCGCGCCGGAAGGGCGAGA TGACCGCGCCCGAGGAAATCCTCCTCGAGCAGAACGCAATGGCGCAGGGCAAGGGCTACTTCAACGTCGGCGAGGCGGTG GTGAGCCAGGACAACCGCCTGCTGGCCTGGGCCGAGGACACGGTGGGCCGGCGCCAGTACGTGCTGAAGGTGAAGGACCT CGCCACCGGCCAGGTGCTGAGCGACACGGTGGAGAACATCGAGCCCAACATCGTCTGGGCCGACGACAACCGGACGATCT TCTACATCGAGAAGGACCCGGTGACCCTGCTGTCGAAGCGGGTGAAGGCGCACGTGCTGGGCACGCCGGCCAGCGCCGAC AGGCTGGTCTACGAGGAGGCGGACGACAGCTTCTACATGGGGCTCGGCCGCACGCGGTCGGACAAGTACCTGTGCGTCCT GCTGCAGAGCACCACGGCCACCGAGCAGCGCTGCACCCCGGCCGCCGCGCCCGGCGCGCTGCAGGTGGTGGCGCCGCGCG AGCGGGACCACCTCTACCAGGCCGACCACCTGGCCGGGCGCTGGGTGATCCGCACGAACTGGGACGCGCCGAACTACCGG CTGATGCAGGCGCCCGACGGCGCCTGGGGCGAGAAGGCGCGCTGGACCGACTTCGTGCCGCACCGGGCCGACGTGTTCAT CCAGGACTTCCGGCTGTTCGACACCTTCACCGCGATCGAGGAGCGTTCGGGCGGACTGAAGCGGCTGCGGCTGCTGAAGC CCGATGGGGGCTCGGAGTTCGTGGCGGCGGACGAGCCGGCCTACACCATGGGCTTCGGGACCAACGCCGAGGCCGACTCC ACGGCGCTGCGCTACACCTACACCTCGCTGACCACGCCGCTGTCGACCTATGACCTGGACCTGGCCACCGGCAAGCGCAC CCTGCTGAAGCAGACCCCGGTGATCGGCTACGATCCCTCGCAGTACGTGACCGAGCGCGTCTGGGCCCCGGCCCGCGACG GGACGAAGATCCCGGTCTCGCTGGTCTACCGGAAGGGCTTCAAGCGCGACGGGACCGCGCCGCTGTTCCAGTACGCCTAC GGCAGCTACGGCATCTCGATGGACCCGGCGTTCAACCTGCCGGCGGTGAGCCTGCTGGACCGCGGGGTCGTCTACGCCAT CGCCCACATCCGCGGCGGCCAGGAGATGGGCCGCAAGTGGTACGACGACGGCAAGCTGCTGAAGAAGCAGAACACCTTCA ACGACTTCGTGGACGTCACCCGCCACCTCGTCGCCAAGAAGTACGCGGCCAGGGAGCGGGTGGGCGCCATGGGCGGCTCG GCCGGCGGCCTGCTGATGGGGGCGGTGGCCAACCAGGCGCCGCAGGACTACCGGGTGATCGTCACCCAGGTGCCGTTCGT GGACGTGGTCACGACCATGCTCGACGAGTCGATCCCGCTGACCACCAACGAGTTCGACGAGTGGGGCAACCCGAAGGACC CGGCCTACTACCGCTACATGCTGGGCTACTCGCCGTACGACAACATCAAGGCCCAGGCCTATCCGGCGATCTTCGTGGGC ACCGGCCTGTGGGACAGCCAGGTGCAGTACTACGAGCCGGCCAAGTACGTGGCGCGGCTGCGCGAGACCAAGACCGACGA CAATCCGCTGGTCTTCCGGGTGAACATGGAGGCCGGCCACGGCGGCAAGTCGGGCCGCTTCCGCCGCTACGAGGAGATGG CGGAGTACTACGCCTTCGTGCTGGACCAGCTCGGGGGGAAGTAG
Upstream 100 bases:
>100_bases CAATCGTAGCACGGGAATTCAACCGGCGCGGCGGCTTGCGGGACGAAGGAACGCATGCCAGCGTCCGCCGCCTCTCGGTC GTGGGGAATTTCGGAACACC
Downstream 100 bases:
>100_bases GGCGTCAGGCCGGCCGCCCCGTCCCGGATGTGTCCCAGGGAAGCGGCCGGCCGAGGCGCACGCGGGCCGCGTCGATCTCG CAGCCGTAGACCAGCACCTC
Product: protease II
Products: NA
Alternate protein names: Oligopeptidase B; Protease II [H]
Number of amino acids: Translated: 707; Mature: 707
Protein sequence:
>707_residues MRIATFAAAAAVLLAGAAQAQAQTQPTTPEPPRAAKRPHEVKAPGGTRTDEYYWLRDDTRKNPEMLAHLAAENAYADAVL AANKPLKEALYKEIVGRVKQDDASVPYRERGYWYYTRFEAGKDYPILARRKGEMTAPEEILLEQNAMAQGKGYFNVGEAV VSQDNRLLAWAEDTVGRRQYVLKVKDLATGQVLSDTVENIEPNIVWADDNRTIFYIEKDPVTLLSKRVKAHVLGTPASAD RLVYEEADDSFYMGLGRTRSDKYLCVLLQSTTATEQRCTPAAAPGALQVVAPRERDHLYQADHLAGRWVIRTNWDAPNYR LMQAPDGAWGEKARWTDFVPHRADVFIQDFRLFDTFTAIEERSGGLKRLRLLKPDGGSEFVAADEPAYTMGFGTNAEADS TALRYTYTSLTTPLSTYDLDLATGKRTLLKQTPVIGYDPSQYVTERVWAPARDGTKIPVSLVYRKGFKRDGTAPLFQYAY GSYGISMDPAFNLPAVSLLDRGVVYAIAHIRGGQEMGRKWYDDGKLLKKQNTFNDFVDVTRHLVAKKYAARERVGAMGGS AGGLLMGAVANQAPQDYRVIVTQVPFVDVVTTMLDESIPLTTNEFDEWGNPKDPAYYRYMLGYSPYDNIKAQAYPAIFVG TGLWDSQVQYYEPAKYVARLRETKTDDNPLVFRVNMEAGHGGKSGRFRRYEEMAEYYAFVLDQLGGK
Sequences:
>Translated_707_residues MRIATFAAAAAVLLAGAAQAQAQTQPTTPEPPRAAKRPHEVKAPGGTRTDEYYWLRDDTRKNPEMLAHLAAENAYADAVL AANKPLKEALYKEIVGRVKQDDASVPYRERGYWYYTRFEAGKDYPILARRKGEMTAPEEILLEQNAMAQGKGYFNVGEAV VSQDNRLLAWAEDTVGRRQYVLKVKDLATGQVLSDTVENIEPNIVWADDNRTIFYIEKDPVTLLSKRVKAHVLGTPASAD RLVYEEADDSFYMGLGRTRSDKYLCVLLQSTTATEQRCTPAAAPGALQVVAPRERDHLYQADHLAGRWVIRTNWDAPNYR LMQAPDGAWGEKARWTDFVPHRADVFIQDFRLFDTFTAIEERSGGLKRLRLLKPDGGSEFVAADEPAYTMGFGTNAEADS TALRYTYTSLTTPLSTYDLDLATGKRTLLKQTPVIGYDPSQYVTERVWAPARDGTKIPVSLVYRKGFKRDGTAPLFQYAY GSYGISMDPAFNLPAVSLLDRGVVYAIAHIRGGQEMGRKWYDDGKLLKKQNTFNDFVDVTRHLVAKKYAARERVGAMGGS AGGLLMGAVANQAPQDYRVIVTQVPFVDVVTTMLDESIPLTTNEFDEWGNPKDPAYYRYMLGYSPYDNIKAQAYPAIFVG TGLWDSQVQYYEPAKYVARLRETKTDDNPLVFRVNMEAGHGGKSGRFRRYEEMAEYYAFVLDQLGGK >Mature_707_residues MRIATFAAAAAVLLAGAAQAQAQTQPTTPEPPRAAKRPHEVKAPGGTRTDEYYWLRDDTRKNPEMLAHLAAENAYADAVL AANKPLKEALYKEIVGRVKQDDASVPYRERGYWYYTRFEAGKDYPILARRKGEMTAPEEILLEQNAMAQGKGYFNVGEAV VSQDNRLLAWAEDTVGRRQYVLKVKDLATGQVLSDTVENIEPNIVWADDNRTIFYIEKDPVTLLSKRVKAHVLGTPASAD RLVYEEADDSFYMGLGRTRSDKYLCVLLQSTTATEQRCTPAAAPGALQVVAPRERDHLYQADHLAGRWVIRTNWDAPNYR LMQAPDGAWGEKARWTDFVPHRADVFIQDFRLFDTFTAIEERSGGLKRLRLLKPDGGSEFVAADEPAYTMGFGTNAEADS TALRYTYTSLTTPLSTYDLDLATGKRTLLKQTPVIGYDPSQYVTERVWAPARDGTKIPVSLVYRKGFKRDGTAPLFQYAY GSYGISMDPAFNLPAVSLLDRGVVYAIAHIRGGQEMGRKWYDDGKLLKKQNTFNDFVDVTRHLVAKKYAARERVGAMGGS AGGLLMGAVANQAPQDYRVIVTQVPFVDVVTTMLDESIPLTTNEFDEWGNPKDPAYYRYMLGYSPYDNIKAQAYPAIFVG TGLWDSQVQYYEPAKYVARLRETKTDDNPLVFRVNMEAGHGGKSGRFRRYEEMAEYYAFVLDQLGGK
Specific function: Cleaves peptide bonds on the C-terminal side of lysyl and argininyl residues [H]
COG id: COG1770
COG function: function code E; Protease II
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the peptidase S9A family [H]
Homologues:
Organism=Homo sapiens, GI41349456, Length=709, Percent_Identity=25.3878702397743, Blast_Score=201, Evalue=2e-51, Organism=Homo sapiens, GI284172438, Length=426, Percent_Identity=27.4647887323944, Blast_Score=152, Evalue=2e-36, Organism=Homo sapiens, GI284172431, Length=426, Percent_Identity=27.4647887323944, Blast_Score=152, Evalue=2e-36, Organism=Homo sapiens, GI284172420, Length=426, Percent_Identity=27.4647887323944, Blast_Score=151, Evalue=2e-36, Organism=Homo sapiens, GI284172413, Length=426, Percent_Identity=27.4647887323944, Blast_Score=151, Evalue=2e-36, Organism=Homo sapiens, GI70778815, Length=426, Percent_Identity=27.4647887323944, Blast_Score=151, Evalue=2e-36, Organism=Homo sapiens, GI108860686, Length=281, Percent_Identity=31.6725978647687, Blast_Score=139, Evalue=1e-32, Organism=Homo sapiens, GI108860692, Length=212, Percent_Identity=33.9622641509434, Blast_Score=128, Evalue=2e-29, Organism=Escherichia coli, GI1788150, Length=674, Percent_Identity=46.2908011869436, Blast_Score=626, Evalue=1e-180, Organism=Drosophila melanogaster, GI24583414, Length=707, Percent_Identity=25.035360678925, Blast_Score=193, Evalue=4e-49, Organism=Drosophila melanogaster, GI221510989, Length=683, Percent_Identity=24.3045387994143, Blast_Score=174, Evalue=3e-43,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR002471 - InterPro: IPR001375 - InterPro: IPR002470 - InterPro: IPR004106 [H]
Pfam domain/function: PF00326 Peptidase_S9; PF02897 Peptidase_S9_N [H]
EC number: =3.4.21.83 [H]
Molecular weight: Translated: 79222; Mature: 79222
Theoretical pI: Translated: 7.03; Mature: 7.03
Prosite motif: PS00501 SPASE_I_1
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.3 %Cys (Translated Protein) 2.1 %Met (Translated Protein) 2.4 %Cys+Met (Translated Protein) 0.3 %Cys (Mature Protein) 2.1 %Met (Mature Protein) 2.4 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MRIATFAAAAAVLLAGAAQAQAQTQPTTPEPPRAAKRPHEVKAPGGTRTDEYYWLRDDTR CCCHHHHHHHHHHHHCCHHHHCCCCCCCCCCCCHHCCCCCCCCCCCCCCCCEEEECCCCC KNPEMLAHLAAENAYADAVLAANKPLKEALYKEIVGRVKQDDASVPYRERGYWYYTRFEA CCHHHHHHHHHCCHHHHHHEECCCCHHHHHHHHHHHHHCCCCCCCCCHHCCEEEEEEECC GKDYPILARRKGEMTAPEEILLEQNAMAQGKGYFNVGEAVVSQDNRLLAWAEDTVGRRQY CCCCCEEEECCCCCCCCHHHHHCCCHHHCCCCCEEHHHHHHCCCCEEEEEECCCCCCEEE VLKVKDLATGQVLSDTVENIEPNIVWADDNRTIFYIEKDPVTLLSKRVKAHVLGTPASAD EEEEECCCCCHHHHHHHHCCCCCEEEECCCCEEEEECCCCHHHHHHHHHHEEECCCCCCC RLVYEEADDSFYMGLGRTRSDKYLCVLLQSTTATEQRCTPAAAPGALQVVAPRERDHLYQ CEEEECCCCCEEEECCCCCCCCEEEEEEECCCCCHHCCCCCCCCCEEEEECCCCHHHHHH ADHLAGRWVIRTNWDAPNYRLMQAPDGAWGEKARWTDFVPHRADVFIQDFRLFDTFTAIE HHCCCCEEEEEECCCCCCEEEEECCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHH ERSGGLKRLRLLKPDGGSEFVAADEPAYTMGFGTNAEADSTALRYTYTSLTTPLSTYDLD HHCCCCEEEEEECCCCCCCEEECCCCCEEECCCCCCCCCCCEEEEEEHHHCCCCCCEEEE LATGKRTLLKQTPVIGYDPSQYVTERVWAPARDGTKIPVSLVYRKGFKRDGTAPLFQYAY CCCCCHHHHHCCCCCCCCCHHHHHHHHCCCCCCCCCCCHHHEECCCCCCCCCCHHHHHHH GSYGISMDPAFNLPAVSLLDRGVVYAIAHIRGGQEMGRKWYDDGKLLKKQNTFNDFVDVT CCCCCCCCCCCCCCHHHHHHCCCEEEEEHHCCCHHHHHHCCCCCCEEECCCCHHHHHHHH RHLVAKKYAARERVGAMGGSAGGLLMGAVANQAPQDYRVIVTQVPFVDVVTTMLDESIPL HHHHHHHHHHHHHHHCCCCCCCCHHHHHHHCCCCCCEEEEEEECCHHHHHHHHHCCCCCC TTNEFDEWGNPKDPAYYRYMLGYSPYDNIKAQAYPAIFVGTGLWDSQVQYYEPAKYVARL CCCCHHHCCCCCCCCEEEEEECCCCCCCCCCCCCCEEEEECCCCCCCCHHCCHHHHHHHH RETKTDDNPLVFRVNMEAGHGGKSGRFRRYEEMAEYYAFVLDQLGGK HHCCCCCCCEEEEEEECCCCCCCCCCHHHHHHHHHHHHHHHHHHCCC >Mature Secondary Structure MRIATFAAAAAVLLAGAAQAQAQTQPTTPEPPRAAKRPHEVKAPGGTRTDEYYWLRDDTR CCCHHHHHHHHHHHHCCHHHHCCCCCCCCCCCCHHCCCCCCCCCCCCCCCCEEEECCCCC KNPEMLAHLAAENAYADAVLAANKPLKEALYKEIVGRVKQDDASVPYRERGYWYYTRFEA CCHHHHHHHHHCCHHHHHHEECCCCHHHHHHHHHHHHHCCCCCCCCCHHCCEEEEEEECC GKDYPILARRKGEMTAPEEILLEQNAMAQGKGYFNVGEAVVSQDNRLLAWAEDTVGRRQY CCCCCEEEECCCCCCCCHHHHHCCCHHHCCCCCEEHHHHHHCCCCEEEEEECCCCCCEEE VLKVKDLATGQVLSDTVENIEPNIVWADDNRTIFYIEKDPVTLLSKRVKAHVLGTPASAD EEEEECCCCCHHHHHHHHCCCCCEEEECCCCEEEEECCCCHHHHHHHHHHEEECCCCCCC RLVYEEADDSFYMGLGRTRSDKYLCVLLQSTTATEQRCTPAAAPGALQVVAPRERDHLYQ CEEEECCCCCEEEECCCCCCCCEEEEEEECCCCCHHCCCCCCCCCEEEEECCCCHHHHHH ADHLAGRWVIRTNWDAPNYRLMQAPDGAWGEKARWTDFVPHRADVFIQDFRLFDTFTAIE HHCCCCEEEEEECCCCCCEEEEECCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHH ERSGGLKRLRLLKPDGGSEFVAADEPAYTMGFGTNAEADSTALRYTYTSLTTPLSTYDLD HHCCCCEEEEEECCCCCCCEEECCCCCEEECCCCCCCCCCCEEEEEEHHHCCCCCCEEEE LATGKRTLLKQTPVIGYDPSQYVTERVWAPARDGTKIPVSLVYRKGFKRDGTAPLFQYAY CCCCCHHHHHCCCCCCCCCHHHHHHHHCCCCCCCCCCCHHHEECCCCCCCCCCHHHHHHH GSYGISMDPAFNLPAVSLLDRGVVYAIAHIRGGQEMGRKWYDDGKLLKKQNTFNDFVDVT CCCCCCCCCCCCCCHHHHHHCCCEEEEEHHCCCHHHHHHCCCCCCEEECCCCHHHHHHHH RHLVAKKYAARERVGAMGGSAGGLLMGAVANQAPQDYRVIVTQVPFVDVVTTMLDESIPL HHHHHHHHHHHHHHHCCCCCCCCHHHHHHHCCCCCCEEEEEEECCHHHHHHHHHCCCCCC TTNEFDEWGNPKDPAYYRYMLGYSPYDNIKAQAYPAIFVGTGLWDSQVQYYEPAKYVARL CCCCHHHCCCCCCCCEEEEEECCCCCCCCCCCCCCEEEEECCCCCCCCHHCCHHHHHHHH RETKTDDNPLVFRVNMEAGHGGKSGRFRRYEEMAEYYAFVLDQLGGK HHCCCCCCCEEEEEEECCCCCCCCCCHHHHHHHHHHHHHHHHHHCCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 1769955; 9097040; 9278503 [H]