| Definition | Herpetosiphon aurantiacus ATCC 23779 chromosome, complete genome. |
|---|---|
| Accession | NC_009972 |
| Length | 6,346,587 |
Click here to switch to the map view.
The map label for this gene is bpr [H]
Identifier: 159899715
GI number: 159899715
Start: 4043339
End: 4045588
Strand: Reverse
Name: bpr [H]
Synonym: Haur_3197
Alternate gene names: 159899715
Gene position: 4045588-4043339 (Counterclockwise)
Preceding gene: 159899720
Following gene: 159899714
Centisome position: 63.74
GC content: 53.16
Gene sequence:
>2250_bases ATGCGTCTGATCAAACCATTCATCCTCCTAATGGTGTTAGCAGGCTTTTGTCTGCCAAGCGCCTCCGCCAACCCCCCCGA CCGTCTCGCAAGCAAAGCCGATTCAGCCCTGCTGGCAAAGCTGAATGCTGGCCAACAAGTGCCAACCCTCGTGCTATTGC AAGCCCAAGTCGATACCAACTTCGCTGATCGTTTGGCCAGTAAAGAAGCCAAGGGTGCGGCGGTGGTTGCCGCCCTGCGC CAACAAGCCCAACGCGATCAAACTCCACTGCTTGCCGAACTCAGCAACCGCGGGATTCAATCCGAGGGCTTTCTCTCGGT TAATGCCTTGTATGCGACGCTTGATTTAGCCAGCGCTCAATGGCTGGCCGAACAAGCCAGCGTCAAGCAATTGATCGAAG ATTCGATTGTGGTCAAGGTCGAAAAACCAGTTGCCGAAACTAACCCAGCACCCCAAGCGGTGAATACCACGACCTGGGGG GTTAACTATGTCAAAGCCCCCGAAGTGTGGGCTAAAGGCATTACTGGCCAAGGCATCGTAATTGCTGGCGAAGATACTGG GGTGCGCTGGACGCACGCCGCATTGAAGAGCAAATATCGCGGCTGGGATGGCACAAATGCTAGTCACGATTACAACTGGT ACGACGGCATTCGCACTTCGTTAGGTGGCACGAATCCTTGTGGTTTAGCGCTGAACGTGCCTTGTGACGATAACTCGCAT GGCACTCACACCGTTGGTACGGTTGTTGGCGATAATGGCACGGGCGAACAAATTGGGGTTGCGCCTGGCGCAAAATGGAT CGCCTGCCGTAACATGGATGCTGGCAACGGTACGCCTGCAACCTACATTCGCTGTATCGACTGGATGTTGGCTCCGTTCC CCACTGCTGGCACCAGTGCTCAAGGCGACCCCAGCAAAGCGCCGCACGTTGTCAACAATTCATGGGGCTGCCTAGCCTCA GAAGGTTGTACCAATACCCCTTCTGATGGCATTCAGACCTCAGTTCAAAATGTGACCAATGCAGGGATTATGTTTGTGGC CTCAGCAGGGAATGATGGGAGCGGTTGTGCCACCATCACCACGCCAGTCGCGATCTACCCTGAAAGCTTTGTGGTTGGCT CACATACCTCAACTGGGGCAATTTCTGGGTTTAGCAGCCGTGGTCCAGCTACCAACAATGGTGCCAGCCGAATCGGCCCA GACATTTCAGCCCCAGGCTCATCTGTGCGTTCGGCAACCAATGGTGGTGATGATGTTTATGGTTCAAGCTCGGGCACGAG TATGGCTAGCCCGCACGTAGTTGGGGTTGTGGCCTTGTTGTGGTCGGCTCGCCCAGAACTGCAAGGCCAAGTTGATCTCA CTCGTGCGATCTTGCAAGAAACCGCTACTGCTGCGCCTTCAACCCAAACCTGTGGTGGTGTTGCTGGTAGCAGCATCCCC AACAATACCTTTGGTCATGGCTATGTCAATGCTTTGAATGCGATTGCCCCAACCTTGCAAGGCAGCATCACGGTCGATGG CACGGCGGCAACCTCAGCCACCATTCGCTTGGAAAATAGCGTTGGCGTGGTTGAATTTGGCAAAACCACTGGTGTCTATA GCACCAGCTTGCCAGCAGGCCTCTACAGTGCAACCGTTACTGTGCCAAACGAAACGCCAATTACTCGCCAAGTAACGATT GTCAAAGGCCAAGTTGCGACTGAAAACTTTGAATTTGGCGATGTGACTGGTACTGTTAGTGGTCATGCAACCCTCAATGG CACGGGCCGCGCTGGTGTCAGCATCACCGCCAACCCCGGCAACTTCACCACCGAAACCAACGCTAACGGCGATTACAACT TAGCCTTAGCCCCGGGAACCTATACGATTTCTAGCGAATTTATGGCCTTGGAAACCCAAGTGGCAACGGTAACGGTGGTT CTCAATCAGACCGTCATCCAAGATTTTGATTTCGCGACCACCCAAACCATCAATATTCAGAACTTCCGGTTTAGCCCTAG CCCAATTACGGTTACCTTGGGAACCAGCATCTTGTGGCGTAACCTTGATGCTTCGACCCACACCACGACCCGTGGTCAAA TGCCGTTTATTTGGGATTCAGGCGATCTGAGCCAGAACCAAGATTATGCCGTAACCTTTGATCAAGTTGGTACTTTCAGC TATGTTTGTAGCTTGCATGGCAGTATGCAAGGTACGGTTGTGGTAACTCCACCAATGCAAAATACCTATCTGCCGTGGAC AACTAAATAA
Upstream 100 bases:
>100_bases AGCGTATTGAGCAATCTATCAGCATCATGCTATTTTACCATGCCCAAAAGTTTGCTATACTTGCCCCAACCTTAATATCT TTTACCTGTGTGGGGAGCCT
Downstream 100 bases:
>100_bases CCTATCGCCTATTCAATGGTACTATGGCACAGTCTGGACAACAGGCTGTGTCATTGTTTTAGCTCGCTTTTTGGAAGCCA CATGCAGCAACATTCTCGAT
Product: peptidase S8/S53 subtilisin kexin sedolisin
Products: NA
Alternate protein names: 90 kDa serine proteinase; Esterase; RP-I protease [H]
Number of amino acids: Translated: 749; Mature: 749
Protein sequence:
>749_residues MRLIKPFILLMVLAGFCLPSASANPPDRLASKADSALLAKLNAGQQVPTLVLLQAQVDTNFADRLASKEAKGAAVVAALR QQAQRDQTPLLAELSNRGIQSEGFLSVNALYATLDLASAQWLAEQASVKQLIEDSIVVKVEKPVAETNPAPQAVNTTTWG VNYVKAPEVWAKGITGQGIVIAGEDTGVRWTHAALKSKYRGWDGTNASHDYNWYDGIRTSLGGTNPCGLALNVPCDDNSH GTHTVGTVVGDNGTGEQIGVAPGAKWIACRNMDAGNGTPATYIRCIDWMLAPFPTAGTSAQGDPSKAPHVVNNSWGCLAS EGCTNTPSDGIQTSVQNVTNAGIMFVASAGNDGSGCATITTPVAIYPESFVVGSHTSTGAISGFSSRGPATNNGASRIGP DISAPGSSVRSATNGGDDVYGSSSGTSMASPHVVGVVALLWSARPELQGQVDLTRAILQETATAAPSTQTCGGVAGSSIP NNTFGHGYVNALNAIAPTLQGSITVDGTAATSATIRLENSVGVVEFGKTTGVYSTSLPAGLYSATVTVPNETPITRQVTI VKGQVATENFEFGDVTGTVSGHATLNGTGRAGVSITANPGNFTTETNANGDYNLALAPGTYTISSEFMALETQVATVTVV LNQTVIQDFDFATTQTINIQNFRFSPSPITVTLGTSILWRNLDASTHTTTRGQMPFIWDSGDLSQNQDYAVTFDQVGTFS YVCSLHGSMQGTVVVTPPMQNTYLPWTTK
Sequences:
>Translated_749_residues MRLIKPFILLMVLAGFCLPSASANPPDRLASKADSALLAKLNAGQQVPTLVLLQAQVDTNFADRLASKEAKGAAVVAALR QQAQRDQTPLLAELSNRGIQSEGFLSVNALYATLDLASAQWLAEQASVKQLIEDSIVVKVEKPVAETNPAPQAVNTTTWG VNYVKAPEVWAKGITGQGIVIAGEDTGVRWTHAALKSKYRGWDGTNASHDYNWYDGIRTSLGGTNPCGLALNVPCDDNSH GTHTVGTVVGDNGTGEQIGVAPGAKWIACRNMDAGNGTPATYIRCIDWMLAPFPTAGTSAQGDPSKAPHVVNNSWGCLAS EGCTNTPSDGIQTSVQNVTNAGIMFVASAGNDGSGCATITTPVAIYPESFVVGSHTSTGAISGFSSRGPATNNGASRIGP DISAPGSSVRSATNGGDDVYGSSSGTSMASPHVVGVVALLWSARPELQGQVDLTRAILQETATAAPSTQTCGGVAGSSIP NNTFGHGYVNALNAIAPTLQGSITVDGTAATSATIRLENSVGVVEFGKTTGVYSTSLPAGLYSATVTVPNETPITRQVTI VKGQVATENFEFGDVTGTVSGHATLNGTGRAGVSITANPGNFTTETNANGDYNLALAPGTYTISSEFMALETQVATVTVV LNQTVIQDFDFATTQTINIQNFRFSPSPITVTLGTSILWRNLDASTHTTTRGQMPFIWDSGDLSQNQDYAVTFDQVGTFS YVCSLHGSMQGTVVVTPPMQNTYLPWTTK >Mature_749_residues MRLIKPFILLMVLAGFCLPSASANPPDRLASKADSALLAKLNAGQQVPTLVLLQAQVDTNFADRLASKEAKGAAVVAALR QQAQRDQTPLLAELSNRGIQSEGFLSVNALYATLDLASAQWLAEQASVKQLIEDSIVVKVEKPVAETNPAPQAVNTTTWG VNYVKAPEVWAKGITGQGIVIAGEDTGVRWTHAALKSKYRGWDGTNASHDYNWYDGIRTSLGGTNPCGLALNVPCDDNSH GTHTVGTVVGDNGTGEQIGVAPGAKWIACRNMDAGNGTPATYIRCIDWMLAPFPTAGTSAQGDPSKAPHVVNNSWGCLAS EGCTNTPSDGIQTSVQNVTNAGIMFVASAGNDGSGCATITTPVAIYPESFVVGSHTSTGAISGFSSRGPATNNGASRIGP DISAPGSSVRSATNGGDDVYGSSSGTSMASPHVVGVVALLWSARPELQGQVDLTRAILQETATAAPSTQTCGGVAGSSIP NNTFGHGYVNALNAIAPTLQGSITVDGTAATSATIRLENSVGVVEFGKTTGVYSTSLPAGLYSATVTVPNETPITRQVTI VKGQVATENFEFGDVTGTVSGHATLNGTGRAGVSITANPGNFTTETNANGDYNLALAPGTYTISSEFMALETQVATVTVV LNQTVIQDFDFATTQTINIQNFRFSPSPITVTLGTSILWRNLDASTHTTTRGQMPFIWDSGDLSQNQDYAVTFDQVGTFS YVCSLHGSMQGTVVVTPPMQNTYLPWTTK
Specific function: Unknown
COG id: COG1404
COG function: function code O; Subtilisin-like serine proteases
Gene ontology:
Cell location: Secreted [H]
Metaboloic importance: NA
Operon status: Not Known
Operon components: None
Similarity: Belongs to the peptidase S8 family [H]
Homologues:
None
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR008969 - InterPro: IPR014766 - InterPro: IPR008985 - InterPro: IPR012103 - InterPro: IPR008757 - InterPro: IPR000209 - InterPro: IPR022398 - InterPro: IPR015500 - InterPro: IPR010259 [H]
Pfam domain/function: PF05922 Inhibitor_I9; PF05547 Peptidase_M6; PF00082 Peptidase_S8 [H]
EC number: NA
Molecular weight: Translated: 77926; Mature: 77926
Theoretical pI: Translated: 4.96; Mature: 4.96
Prosite motif: PS00138 SUBTILASE_SER
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.3 %Cys (Translated Protein) 1.3 %Met (Translated Protein) 2.7 %Cys+Met (Translated Protein) 1.3 %Cys (Mature Protein) 1.3 %Met (Mature Protein) 2.7 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MRLIKPFILLMVLAGFCLPSASANPPDRLASKADSALLAKLNAGQQVPTLVLLQAQVDTN CCHHHHHHHHHHHHHHCCCCCCCCCHHHHHHHHCCCEEEECCCCCCCCEEEEEEEECCCC FADRLASKEAKGAAVVAALRQQAQRDQTPLLAELSNRGIQSEGFLSVNALYATLDLASAQ HHHHHHCCCCCCHHHHHHHHHHHHHCCCCHHHHHHCCCCCCCCCEEEEEEEEEHHHHHHH WLAEQASVKQLIEDSIVVKVEKPVAETNPAPQAVNTTTWGVNYVKAPEVWAKGITGQGIV HHHHHHHHHHHHCCCEEEEEECCCCCCCCCCCCCCCEECCEEEEECCHHHHCCCCCCEEE IAGEDTGVRWTHAALKSKYRGWDGTNASHDYNWYDGIRTSLGGTNPCGLALNVPCDDNSH EECCCCCCEEHHHHHHHHCCCCCCCCCCCCCCHHHHHHHHCCCCCCCCEEEECCCCCCCC GTHTVGTVVGDNGTGEQIGVAPGAKWIACRNMDAGNGTPATYIRCIDWMLAPFPTAGTSA CCEEEEEEECCCCCCCEEECCCCCCEEEEECCCCCCCCHHHHHHHHHHHHCCCCCCCCCC QGDPSKAPHVVNNSWGCLASEGCTNTPSDGIQTSVQNVTNAGIMFVASAGNDGSGCATIT CCCCCCCCEEECCCCCCEECCCCCCCCCHHHHHHHHHHCCCCEEEEEECCCCCCCEEEEE TPVAIYPESFVVGSHTSTGAISGFSSRGPATNNGASRIGPDISAPGSSVRSATNGGDDVY CCEEECCCCEEEECCCCCCCCCCCCCCCCCCCCCCHHCCCCCCCCCHHHHCCCCCCCCCC GSSSGTSMASPHVVGVVALLWSARPELQGQVDLTRAILQETATAAPSTQTCGGVAGSSIP CCCCCCCCCCCHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCC NNTFGHGYVNALNAIAPTLQGSITVDGTAATSATIRLENSVGVVEFGKTTGVYSTSLPAG CCCCCCHHHHHHHHHHHHHCCCEEECCCCCCEEEEEECCCCCEEEECCCCCEEECCCCCC LYSATVTVPNETPITRQVTIVKGQVATENFEFGDVTGTVSGHATLNGTGRAGVSITANPG EEEEEEECCCCCCCEEEEEEEEEEEECCCCCCCCEEEEECCCEEECCCCCCCEEEEECCC NFTTETNANGDYNLALAPGTYTISSEFMALETQVATVTVVLNQTVIQDFDFATTQTINIQ CCEECCCCCCCEEEEECCCEEEECCCEEEEEEEEEEEEEEECHHHHHCCCCCEEEEEEEE NFRFSPSPITVTLGTSILWRNLDASTHTTTRGQMPFIWDSGDLSQNQDYAVTFDQVGTFS EEEECCCCEEEEECCEEEEECCCCCCCCCCCCCCCEEECCCCCCCCCCEEEEHHHCCCEE YVCSLHGSMQGTVVVTPPMQNTYLPWTTK EHHHHCCCCCCCEEEECCCCCCCCCCCCC >Mature Secondary Structure MRLIKPFILLMVLAGFCLPSASANPPDRLASKADSALLAKLNAGQQVPTLVLLQAQVDTN CCHHHHHHHHHHHHHHCCCCCCCCCHHHHHHHHCCCEEEECCCCCCCCEEEEEEEECCCC FADRLASKEAKGAAVVAALRQQAQRDQTPLLAELSNRGIQSEGFLSVNALYATLDLASAQ HHHHHHCCCCCCHHHHHHHHHHHHHCCCCHHHHHHCCCCCCCCCEEEEEEEEEHHHHHHH WLAEQASVKQLIEDSIVVKVEKPVAETNPAPQAVNTTTWGVNYVKAPEVWAKGITGQGIV HHHHHHHHHHHHCCCEEEEEECCCCCCCCCCCCCCCEECCEEEEECCHHHHCCCCCCEEE IAGEDTGVRWTHAALKSKYRGWDGTNASHDYNWYDGIRTSLGGTNPCGLALNVPCDDNSH EECCCCCCEEHHHHHHHHCCCCCCCCCCCCCCHHHHHHHHCCCCCCCCEEEECCCCCCCC GTHTVGTVVGDNGTGEQIGVAPGAKWIACRNMDAGNGTPATYIRCIDWMLAPFPTAGTSA CCEEEEEEECCCCCCCEEECCCCCCEEEEECCCCCCCCHHHHHHHHHHHHCCCCCCCCCC QGDPSKAPHVVNNSWGCLASEGCTNTPSDGIQTSVQNVTNAGIMFVASAGNDGSGCATIT CCCCCCCCEEECCCCCCEECCCCCCCCCHHHHHHHHHHCCCCEEEEEECCCCCCCEEEEE TPVAIYPESFVVGSHTSTGAISGFSSRGPATNNGASRIGPDISAPGSSVRSATNGGDDVY CCEEECCCCEEEECCCCCCCCCCCCCCCCCCCCCCHHCCCCCCCCCHHHHCCCCCCCCCC GSSSGTSMASPHVVGVVALLWSARPELQGQVDLTRAILQETATAAPSTQTCGGVAGSSIP CCCCCCCCCCCHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCC NNTFGHGYVNALNAIAPTLQGSITVDGTAATSATIRLENSVGVVEFGKTTGVYSTSLPAG CCCCCCHHHHHHHHHHHHHCCCEEECCCCCCEEEEEECCCCCEEEECCCCCEEECCCCCC LYSATVTVPNETPITRQVTIVKGQVATENFEFGDVTGTVSGHATLNGTGRAGVSITANPG EEEEEEECCCCCCCEEEEEEEEEEEECCCCCCCCEEEEECCCEEECCCCCCCEEEEECCC NFTTETNANGDYNLALAPGTYTISSEFMALETQVATVTVVLNQTVIQDFDFATTQTINIQ CCEECCCCCCCEEEEECCCEEEECCCEEEEEEEEEEEEEEECHHHHHCCCCCEEEEEEEE NFRFSPSPITVTLGTSILWRNLDASTHTTTRGQMPFIWDSGDLSQNQDYAVTFDQVGTFS EEEECCCCEEEEECCEEEEECCCCCCCCCCCCCCCEEECCCCCCCCCCEEEEHHHCCCEE YVCSLHGSMQGTVVVTPPMQNTYLPWTTK EHHHHCCCCCCCEEEECCCCCCCCCCCCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 2106512; 2118514; 2108961; 9384377; 3139638; 2106671 [H]