Definition Methanosphaera stadtmanae DSM 3091 chromosome, complete genome.
Accession NC_007681
Length 1,767,403

Click here to switch to the map view.

The map label for this gene is 84489581

Identifier: 84489581

GI number: 84489581

Start: 906490

End: 912117

Strand: Direct

Name: 84489581

Synonym: Msp_0777

Alternate gene names: NA

Gene position: 906490-912117 (Clockwise)

Preceding gene: 84489580

Following gene: 84489585

Centisome position: 51.29

GC content: 27.2

Gene sequence:

>5628_bases
ATGAATAAAAAAATATTACTTACTTTATTAGTAATAATAATGTTTTTTAGTATTTCTTCTGTTTATGCAGTAGATAATTC
TATAGATTCATCTAACACATATTCAAATTTAAATACTTTAAAACATACTGATACATACCAATCTTCCCTCATAGATAATA
TAAACGAAAATATATCATCTAAAACGGTAGAAAAAGAAATATCAGTAGAAACTAAAGAAAAAACAGAAAAATCTATAACA
AAGAGTGATAATAAGTTAAATACCAATAACTATGTAGTTAACAAAAAATCAAGTGATACTCAAACTAAAGTAGATGTTAT
TTCCAAAGATACATCTACAAAAAAAGTAAATAAAACTTTGAAAACTACAGATAATTATTACTTCAATGCTTCTGTTACAA
ATGATGGTGATGGAAGTAAAGATAATCCATGGAAAACAATTAACCAATTAAATTTCAACAAGATTACAAATGGAAGTACT
GTATATATATCCAATGGTAATTATAATGTAGATAATATTGATGTTAATATTGATGTTAATATTATTGGTGAAAATACCAA
TAAAACCATAATAAAAGGATATAATACATATGATGAAGTATTTAATTTTAATAAGCATACAACAATAACAAATATAACAT
TTACAAATTCAAGTACAAAAGTAATTTATAATACTGGTACACTTGAACTTAATAATTGTATTTTTAAAAATAACAATATA
ACATCATATGATGCATGTATAAAAAATAATGGAAAACTAACAGTGAATAATTGTTTATTTAACAATGTATCCTCACAAAA
AAGTAGTGTTATTTATAATTCAGCAAGTAATTCCATTAACTTATATCTAAAAAACTCCATATTCACAAATAACAATGCAT
ATAAAGGTATTGTATTGTTATATGGAAGTTGTGCTCAGTTATATAACACAACATTCAATAACAATAAAGCTACTATTATG
GCCGGATGCATATATTTAGAGAAAAGTTCTATGAATGTTAATTTAAGTACTTTTATAAACAATTCTGTGCTTAAAGGTAC
TGGTGGTGTATTCTATGTTTATGATAGTGATTTATTTGTAAATAATTCAATATTTTCCAATAACTATGCATTATTTGGTG
GTGTAGCAACATTTCTAAATGGTTCTGGTGATGGAGAAGAGATAACAGAATCAAAACACAACAGTACAATAATAAATTCT
TCTTTCACAAACAACAAAGTATTATATGATGGAGGAGTATTCTTTGATGTATATTCAAATCTTGATATAAGATCATCTAA
TTTCACTAATAACTCTGCAAGAAATGGTGGAAGCATATATGGTGACTACTCAAAAATCAACATAAACAACACTATCTTCA
AGAATAATACAGCCACATACTTTGGTGGAAGTATCTATACAAATCAGATAGATATTGCACTTAACAACAACAACTTCATA
AATAACAAGGCAACAAAAGCAGAAGATGTCTACTCACAATATTCTAGAAGTTTTACCTCAAAAAACAACACACAAACAAA
TACTAATTCAATAATAACAAATCAAATAACAACCACTAAAAAACCACAAGTAATTATCACTAACCTAAATAATACACCAA
TTACAACAATACCTTCAAGTTATGATTTAAGAAAATTAAATCAAGTAACAAGTGTTAAAAGTCAAAGTGGTGGGGGTAAC
TGTTGGTCATTTGCAACAATGGGTGCTCTTGAATCATGTATTCTTAAAGCAACAGGTATTTCATATGATTTATCTGAGAA
TAACATGAAAAATATAATGGCACTATTTTCACAATCAGCATGGTGCATATCACCAAATTTAGGTGGATATGATGAAATGC
CAATAACATATCTAATAAATTGGTATGGACCTACAGATGAAAATAATGATCCATATATACCAGAGATTATAGTATCTCCT
CAAATTAACAATTTAATACAAATAAATAATGTGTATGGAATTCCAAGTAGAACAAATTATACTGATAATAATGAATATAA
AAAAGCTATAATGAAGTATGGAGCAGTATATACTGATATTTATTGGCTTGGTTCAAATGTAGATAATACTCATAATTCAT
ATTATTGTCATGAAAAACCAGAATATACTAATCATGCAGTTTGTATAGTTGGATGGGATGATAATTATAATAAAAATAAC
TTCATAACTCCAGCACCAGGAAATGGTGCATTTATTATTAAAAATAGTTGGGGTACAAGTTCTGGTGAAAATGGATATTA
TTATGTATCATACTATGATGAAAGTATATTAAATACATGTGATGATATATATGGTGCTGGTGGATTTACATTCATAATCA
ACAACACAGAAACTTATGATAAAATATACCAATATGATGTTGGTGGAATAAGTAACTGGCTTGAATCCAATAAATATGGA
AATTATTCTAATGAATATATATCCTCTGGTAATGAATTAATAAAAGCATTTGGTACATATGTAAGTGATTTAACTAATAA
TTATACTGTAAGTATCTATGTGAATAATGTATTAAAACATACACAAAAAGGATTATTCACACATCTTGGATATGAAACAG
TACAAGTTACAAAATCAATTAATGTAAAAACTAACGATAAAATAAAAGTAGTTCTAGAATTAGTATCATCTTCAACAGTA
CAAATTCCAATATCTGAAAGTAAATATACAAGAATAGTTTCAACAACTAATTCATATGTTAATGGTAAAACTAATTCAGA
TAGTGTAGCTTGTCTTAAATTATATACTTCAGAAATTAATAAATCAGAAGTAGATGCAGTTGTTACTAAATCTAACCTAA
CAAATACACAACTATTAATAAATATCCATGATACTAATGGTAATTCAATAAACACTGGTACAATAACTATAAAAGAAAAT
AACACAATATTAAAAACAGTACAAGTTACAAGTAATCAAACTTATGTTGATTTAGGAATTAAAAAAGGAATACATCTTAT
TACAGTATGTTATAATGCAAGTAATTATGCACCATCAAATACAACTTTATTGTTAAATATTGGGGCAACTACAATTAATT
CTGATGTATTAAATAGTGATCTTAAAAATACTACAATAAAGGTAGTTGTAAGAGATTCTAACAATAACTTAGTAAATAGT
GGTAGAGTTGTAATTTATAATAACAATAACTTATTAACAAACACTACACTTATAAATGGACAGGCAATTATTGTTTTAAA
TCTAAATGCAGGAACACAAACACTAAATATATTATATTTAGATGATAATTTATATCAATCATCAAATATAACCCAGACAA
TAACAGTTAAAGCAATAGACACTAAAATGTCAGTAGTGGCTTATAGTAAATTAACAACAAACTCAACAATAGAAGTAACA
GTAACAGATATAACAGGAAAACTAGTGACAAAAGGACAAGTACAAATAATAAACCAGAATGGACAAGTAATAAAAACAGG
AACAATAAACAATGGAAGAGTAAATATAACACTAACATCACTACCAACAGGACGCCAACAATACACAGCAAAATACACAG
AAGGAACAATATATGGTAATTCATCATATACAGTAATAATAACAGTAAAAACAACAGATACTAAAACAACAGTAAAAGCA
TACTCAAAACTAACAACAAACTCAACAATAGAAGTAACAGTAAAAGACATAACAGGAAAATTAGTGACAAAAGGACAAGT
ACAAATAATAAACCAGAATGGACAAGTAATAAAAACAGGAACAATAAACAATGGAAGAGTAAATATAACACTAACATCAC
TACCAACAGGACGCCAACAATACACAGCAAGATACACAGAAGGAACAATATACACACAATCACAAGCAGGAGTAATAATA
ACAGTAAAAACAACAGATACTAAAACAACAGTAAAAGCATACTCAAAACTAACAACAAACTCAACAATAGAAGTAACAGT
AACAGATATAACAGGAAAACTAGTGACAAAAGGACAAGTACAAATAATAAACCAGAATGGACAAGTAATGAAAACAGGAA
CAATAAATAATGGAAGAGTAAATATAACATTAACATCACTACCAACAGGACGCCAACAATACACAGCAAGATACACAGAA
GGAACAATATACACACAATCACAAGCAGGAGTAATAATAACAGTAAAAACAACAGATACTAAAATATCAGTTGATGTTTA
TAAAAAATACACTACTAATACTTCAATGCAAATAACAGTAAAAGACATAACAGGAAAACTAGTGACAAAAGGACAAATAC
AGATAATAAACCAGAATGGACAAGTAATAAAAACAGGAACAATAAATAATGGAAGAGTAAATATAACATTAACATCACTA
CCAACAGGATCTCAAAAATTTATTGTAAAATACACAGAAGGAACAATATACACACAATCAACATATAATATAACATTAAC
GATAATAAAAGATGACACAACAACCCTTACATACAAAAATATTAAAACATATAATAGTAATACAACAATTGATATTCGAG
TAAATGGTGGAGATAATAATCAAGTAACTGGTAAAGTTCAAATACTTAATAGTAGGGGTAGATTATTAAAATCCATGACT
TTAAAGAATGGTCATGCAATAATTACTCTTGGATTACCTTTAGGTAAACAGACTTTAAGTATAATATATCTTGGAGATAA
AACTCATAGATTAGTTAATGTTTCAGATACAATAAATGTTTTAAATCAAACTGTAAAAAGTTATGATAGTGGAAATGAAA
TTGTTCTTAAAAAAATCATAACTACTAGTGAAAAACCTGATGTTGAAGCATTAGGTGATGATTATCAATATGTTGATGAT
GATGGAACATACACTATTACAAGTAGTGAAATACTTAGAGTACAGAGATTAGATTCTCTTTGTCAACAAATTTATGGTTT
CATGCCTAAATATACCTTCTTTAGAGAGGAAGGCAGTAATATCAAGTATGTTATTGAAAGAAGTAAGTGGAATGTAATAT
CAAGAGCATTGAATAAATATCATGTAAATAAGGGATTTACTGCAGTGAACCCTCCACATGCACTTAGAATAACATTAAAA
GATAAAATTAGATATTATCCAGTATATTATGATTCTCAGGAAGTTATTGGTGGAGTAAGATATACTTGTGGTCCTACAGC
TATGAGTATGATAAGCCAAGGATTAAATAAATATAACAGTGAAAGAAAACTATCAAATGTATATAAGACTACAAGGTCAG
AGGGTACATATGAAAGTAATATTATTAAATATTCACCTTCTGTTAACATGACTTTAATTGATATTCCTGATAGTAAATCT
GCAGTTATTAGTAGTATTCAATCTGGTGCAATGGTTTTATGGCATATTCGTGGTCATTACATGAATGTTATTGGTTATAA
CTCAGCAAATGATAAGTTTTTATGTTTAAATCCTTCAGGACCAAGTCATAATATTGAAGCAGTACAATGGGCTTCTTGGA
ATACTATGATGAAAACTGACAGACCTCTTAAGGGATATGGATTTATGAAAGTAGTACCTAAGTGGTATATAACCAGTTCC
TTAAATTCACAGGTAAAAAACTATTATATGAATATGGGCGGTAAATATACTACTCCTAATAATAGTGAAAAACTTAATAC
AGAGGATGCTGTGACTTATATTGTATAA

Upstream 100 bases:

>100_bases
TAAAATATAAAAAAAAATATTACAAACTTTAAAAAAAAACTTATTTTTTAACAAATTTTAATAAATTTAACTTCTATAAA
TATTAAAAAGGAGGAACGTT

Downstream 100 bases:

>100_bases
GAATAATCTATTATTAGATTATCTTATTCTCTTATTTTTTTTATAAAAAAGTAATATGTATTAAAAATAGTTTTTTGAAT
TTTAAAAAAAAGATTTGTTT

Product: asn/thr-rich large protein family protein

Products: NA

Alternate protein names: Peptidase C1A Papain; Cell Surface Protein; Asn/Thr-Rich Large Protein Family Protein; 5-Nucleotidase/2' 3'-Cyclic Phosphodiesterase-Like Protein; Cysteine Proteinase; Adhesin-Like Protein; Cell Surface-Associated Cysteine Protease; Papain Family Protease; Cysteine Protease C1 Family Protein; Surface Layer Protein B; PKD Domain Containing Protein

Number of amino acids: Translated: 1875; Mature: 1875

Protein sequence:

>1875_residues
MNKKILLTLLVIIMFFSISSVYAVDNSIDSSNTYSNLNTLKHTDTYQSSLIDNINENISSKTVEKEISVETKEKTEKSIT
KSDNKLNTNNYVVNKKSSDTQTKVDVISKDTSTKKVNKTLKTTDNYYFNASVTNDGDGSKDNPWKTINQLNFNKITNGST
VYISNGNYNVDNIDVNIDVNIIGENTNKTIIKGYNTYDEVFNFNKHTTITNITFTNSSTKVIYNTGTLELNNCIFKNNNI
TSYDACIKNNGKLTVNNCLFNNVSSQKSSVIYNSASNSINLYLKNSIFTNNNAYKGIVLLYGSCAQLYNTTFNNNKATIM
AGCIYLEKSSMNVNLSTFINNSVLKGTGGVFYVYDSDLFVNNSIFSNNYALFGGVATFLNGSGDGEEITESKHNSTIINS
SFTNNKVLYDGGVFFDVYSNLDIRSSNFTNNSARNGGSIYGDYSKININNTIFKNNTATYFGGSIYTNQIDIALNNNNFI
NNKATKAEDVYSQYSRSFTSKNNTQTNTNSIITNQITTTKKPQVIITNLNNTPITTIPSSYDLRKLNQVTSVKSQSGGGN
CWSFATMGALESCILKATGISYDLSENNMKNIMALFSQSAWCISPNLGGYDEMPITYLINWYGPTDENNDPYIPEIIVSP
QINNLIQINNVYGIPSRTNYTDNNEYKKAIMKYGAVYTDIYWLGSNVDNTHNSYYCHEKPEYTNHAVCIVGWDDNYNKNN
FITPAPGNGAFIIKNSWGTSSGENGYYYVSYYDESILNTCDDIYGAGGFTFIINNTETYDKIYQYDVGGISNWLESNKYG
NYSNEYISSGNELIKAFGTYVSDLTNNYTVSIYVNNVLKHTQKGLFTHLGYETVQVTKSINVKTNDKIKVVLELVSSSTV
QIPISESKYTRIVSTTNSYVNGKTNSDSVACLKLYTSEINKSEVDAVVTKSNLTNTQLLINIHDTNGNSINTGTITIKEN
NTILKTVQVTSNQTYVDLGIKKGIHLITVCYNASNYAPSNTTLLLNIGATTINSDVLNSDLKNTTIKVVVRDSNNNLVNS
GRVVIYNNNNLLTNTTLINGQAIIVLNLNAGTQTLNILYLDDNLYQSSNITQTITVKAIDTKMSVVAYSKLTTNSTIEVT
VTDITGKLVTKGQVQIINQNGQVIKTGTINNGRVNITLTSLPTGRQQYTAKYTEGTIYGNSSYTVIITVKTTDTKTTVKA
YSKLTTNSTIEVTVKDITGKLVTKGQVQIINQNGQVIKTGTINNGRVNITLTSLPTGRQQYTARYTEGTIYTQSQAGVII
TVKTTDTKTTVKAYSKLTTNSTIEVTVTDITGKLVTKGQVQIINQNGQVMKTGTINNGRVNITLTSLPTGRQQYTARYTE
GTIYTQSQAGVIITVKTTDTKISVDVYKKYTTNTSMQITVKDITGKLVTKGQIQIINQNGQVIKTGTINNGRVNITLTSL
PTGSQKFIVKYTEGTIYTQSTYNITLTIIKDDTTTLTYKNIKTYNSNTTIDIRVNGGDNNQVTGKVQILNSRGRLLKSMT
LKNGHAIITLGLPLGKQTLSIIYLGDKTHRLVNVSDTINVLNQTVKSYDSGNEIVLKKIITTSEKPDVEALGDDYQYVDD
DGTYTITSSEILRVQRLDSLCQQIYGFMPKYTFFREEGSNIKYVIERSKWNVISRALNKYHVNKGFTAVNPPHALRITLK
DKIRYYPVYYDSQEVIGGVRYTCGPTAMSMISQGLNKYNSERKLSNVYKTTRSEGTYESNIIKYSPSVNMTLIDIPDSKS
AVISSIQSGAMVLWHIRGHYMNVIGYNSANDKFLCLNPSGPSHNIEAVQWASWNTMMKTDRPLKGYGFMKVVPKWYITSS
LNSQVKNYYMNMGGKYTTPNNSEKLNTEDAVTYIV

Sequences:

>Translated_1875_residues
MNKKILLTLLVIIMFFSISSVYAVDNSIDSSNTYSNLNTLKHTDTYQSSLIDNINENISSKTVEKEISVETKEKTEKSIT
KSDNKLNTNNYVVNKKSSDTQTKVDVISKDTSTKKVNKTLKTTDNYYFNASVTNDGDGSKDNPWKTINQLNFNKITNGST
VYISNGNYNVDNIDVNIDVNIIGENTNKTIIKGYNTYDEVFNFNKHTTITNITFTNSSTKVIYNTGTLELNNCIFKNNNI
TSYDACIKNNGKLTVNNCLFNNVSSQKSSVIYNSASNSINLYLKNSIFTNNNAYKGIVLLYGSCAQLYNTTFNNNKATIM
AGCIYLEKSSMNVNLSTFINNSVLKGTGGVFYVYDSDLFVNNSIFSNNYALFGGVATFLNGSGDGEEITESKHNSTIINS
SFTNNKVLYDGGVFFDVYSNLDIRSSNFTNNSARNGGSIYGDYSKININNTIFKNNTATYFGGSIYTNQIDIALNNNNFI
NNKATKAEDVYSQYSRSFTSKNNTQTNTNSIITNQITTTKKPQVIITNLNNTPITTIPSSYDLRKLNQVTSVKSQSGGGN
CWSFATMGALESCILKATGISYDLSENNMKNIMALFSQSAWCISPNLGGYDEMPITYLINWYGPTDENNDPYIPEIIVSP
QINNLIQINNVYGIPSRTNYTDNNEYKKAIMKYGAVYTDIYWLGSNVDNTHNSYYCHEKPEYTNHAVCIVGWDDNYNKNN
FITPAPGNGAFIIKNSWGTSSGENGYYYVSYYDESILNTCDDIYGAGGFTFIINNTETYDKIYQYDVGGISNWLESNKYG
NYSNEYISSGNELIKAFGTYVSDLTNNYTVSIYVNNVLKHTQKGLFTHLGYETVQVTKSINVKTNDKIKVVLELVSSSTV
QIPISESKYTRIVSTTNSYVNGKTNSDSVACLKLYTSEINKSEVDAVVTKSNLTNTQLLINIHDTNGNSINTGTITIKEN
NTILKTVQVTSNQTYVDLGIKKGIHLITVCYNASNYAPSNTTLLLNIGATTINSDVLNSDLKNTTIKVVVRDSNNNLVNS
GRVVIYNNNNLLTNTTLINGQAIIVLNLNAGTQTLNILYLDDNLYQSSNITQTITVKAIDTKMSVVAYSKLTTNSTIEVT
VTDITGKLVTKGQVQIINQNGQVIKTGTINNGRVNITLTSLPTGRQQYTAKYTEGTIYGNSSYTVIITVKTTDTKTTVKA
YSKLTTNSTIEVTVKDITGKLVTKGQVQIINQNGQVIKTGTINNGRVNITLTSLPTGRQQYTARYTEGTIYTQSQAGVII
TVKTTDTKTTVKAYSKLTTNSTIEVTVTDITGKLVTKGQVQIINQNGQVMKTGTINNGRVNITLTSLPTGRQQYTARYTE
GTIYTQSQAGVIITVKTTDTKISVDVYKKYTTNTSMQITVKDITGKLVTKGQIQIINQNGQVIKTGTINNGRVNITLTSL
PTGSQKFIVKYTEGTIYTQSTYNITLTIIKDDTTTLTYKNIKTYNSNTTIDIRVNGGDNNQVTGKVQILNSRGRLLKSMT
LKNGHAIITLGLPLGKQTLSIIYLGDKTHRLVNVSDTINVLNQTVKSYDSGNEIVLKKIITTSEKPDVEALGDDYQYVDD
DGTYTITSSEILRVQRLDSLCQQIYGFMPKYTFFREEGSNIKYVIERSKWNVISRALNKYHVNKGFTAVNPPHALRITLK
DKIRYYPVYYDSQEVIGGVRYTCGPTAMSMISQGLNKYNSERKLSNVYKTTRSEGTYESNIIKYSPSVNMTLIDIPDSKS
AVISSIQSGAMVLWHIRGHYMNVIGYNSANDKFLCLNPSGPSHNIEAVQWASWNTMMKTDRPLKGYGFMKVVPKWYITSS
LNSQVKNYYMNMGGKYTTPNNSEKLNTEDAVTYIV
>Mature_1875_residues
MNKKILLTLLVIIMFFSISSVYAVDNSIDSSNTYSNLNTLKHTDTYQSSLIDNINENISSKTVEKEISVETKEKTEKSIT
KSDNKLNTNNYVVNKKSSDTQTKVDVISKDTSTKKVNKTLKTTDNYYFNASVTNDGDGSKDNPWKTINQLNFNKITNGST
VYISNGNYNVDNIDVNIDVNIIGENTNKTIIKGYNTYDEVFNFNKHTTITNITFTNSSTKVIYNTGTLELNNCIFKNNNI
TSYDACIKNNGKLTVNNCLFNNVSSQKSSVIYNSASNSINLYLKNSIFTNNNAYKGIVLLYGSCAQLYNTTFNNNKATIM
AGCIYLEKSSMNVNLSTFINNSVLKGTGGVFYVYDSDLFVNNSIFSNNYALFGGVATFLNGSGDGEEITESKHNSTIINS
SFTNNKVLYDGGVFFDVYSNLDIRSSNFTNNSARNGGSIYGDYSKININNTIFKNNTATYFGGSIYTNQIDIALNNNNFI
NNKATKAEDVYSQYSRSFTSKNNTQTNTNSIITNQITTTKKPQVIITNLNNTPITTIPSSYDLRKLNQVTSVKSQSGGGN
CWSFATMGALESCILKATGISYDLSENNMKNIMALFSQSAWCISPNLGGYDEMPITYLINWYGPTDENNDPYIPEIIVSP
QINNLIQINNVYGIPSRTNYTDNNEYKKAIMKYGAVYTDIYWLGSNVDNTHNSYYCHEKPEYTNHAVCIVGWDDNYNKNN
FITPAPGNGAFIIKNSWGTSSGENGYYYVSYYDESILNTCDDIYGAGGFTFIINNTETYDKIYQYDVGGISNWLESNKYG
NYSNEYISSGNELIKAFGTYVSDLTNNYTVSIYVNNVLKHTQKGLFTHLGYETVQVTKSINVKTNDKIKVVLELVSSSTV
QIPISESKYTRIVSTTNSYVNGKTNSDSVACLKLYTSEINKSEVDAVVTKSNLTNTQLLINIHDTNGNSINTGTITIKEN
NTILKTVQVTSNQTYVDLGIKKGIHLITVCYNASNYAPSNTTLLLNIGATTINSDVLNSDLKNTTIKVVVRDSNNNLVNS
GRVVIYNNNNLLTNTTLINGQAIIVLNLNAGTQTLNILYLDDNLYQSSNITQTITVKAIDTKMSVVAYSKLTTNSTIEVT
VTDITGKLVTKGQVQIINQNGQVIKTGTINNGRVNITLTSLPTGRQQYTAKYTEGTIYGNSSYTVIITVKTTDTKTTVKA
YSKLTTNSTIEVTVKDITGKLVTKGQVQIINQNGQVIKTGTINNGRVNITLTSLPTGRQQYTARYTEGTIYTQSQAGVII
TVKTTDTKTTVKAYSKLTTNSTIEVTVTDITGKLVTKGQVQIINQNGQVMKTGTINNGRVNITLTSLPTGRQQYTARYTE
GTIYTQSQAGVIITVKTTDTKISVDVYKKYTTNTSMQITVKDITGKLVTKGQIQIINQNGQVIKTGTINNGRVNITLTSL
PTGSQKFIVKYTEGTIYTQSTYNITLTIIKDDTTTLTYKNIKTYNSNTTIDIRVNGGDNNQVTGKVQILNSRGRLLKSMT
LKNGHAIITLGLPLGKQTLSIIYLGDKTHRLVNVSDTINVLNQTVKSYDSGNEIVLKKIITTSEKPDVEALGDDYQYVDD
DGTYTITSSEILRVQRLDSLCQQIYGFMPKYTFFREEGSNIKYVIERSKWNVISRALNKYHVNKGFTAVNPPHALRITLK
DKIRYYPVYYDSQEVIGGVRYTCGPTAMSMISQGLNKYNSERKLSNVYKTTRSEGTYESNIIKYSPSVNMTLIDIPDSKS
AVISSIQSGAMVLWHIRGHYMNVIGYNSANDKFLCLNPSGPSHNIEAVQWASWNTMMKTDRPLKGYGFMKVVPKWYITSS
LNSQVKNYYMNMGGKYTTPNNSEKLNTEDAVTYIV

Specific function: Unknown

COG id: COG4870

COG function: function code O; Cysteine protease

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

Organism=Homo sapiens, GI4503155, Length=223, Percent_Identity=26.9058295964126, Blast_Score=69, Evalue=6e-11,
Organism=Homo sapiens, GI22202619, Length=223, Percent_Identity=26.9058295964126, Blast_Score=69, Evalue=6e-11,
Organism=Drosophila melanogaster, GI45552699, Length=300, Percent_Identity=25, Blast_Score=70, Evalue=2e-11,
Organism=Drosophila melanogaster, GI24654437, Length=300, Percent_Identity=25, Blast_Score=70, Evalue=2e-11,
Organism=Drosophila melanogaster, GI24654439, Length=300, Percent_Identity=25, Blast_Score=70, Evalue=2e-11,
Organism=Drosophila melanogaster, GI19922450, Length=300, Percent_Identity=25, Blast_Score=70, Evalue=2e-11,
Organism=Drosophila melanogaster, GI24654434, Length=300, Percent_Identity=25, Blast_Score=69, Evalue=3e-11,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 208138; Mature: 208138

Theoretical pI: Translated: 9.26; Mature: 9.26

Prosite motif: PS00139 THIOL_PROTEASE_CYS ; PS00639 THIOL_PROTEASE_HIS

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.9 %Cys     (Translated Protein)
1.3 %Met     (Translated Protein)
2.1 %Cys+Met (Translated Protein)
0.9 %Cys     (Mature Protein)
1.3 %Met     (Mature Protein)
2.1 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MNKKILLTLLVIIMFFSISSVYAVDNSIDSSNTYSNLNTLKHTDTYQSSLIDNINENISS
CCCCHHHHHHHHHHHHHCCEEEEECCCCCCCCCCCCCCCEECCCHHHHHHHHHHHCCCCH
KTVEKEISVETKEKTEKSITKSDNKLNTNNYVVNKKSSDTQTKVDVISKDTSTKKVNKTL
HHEHHHCCCCCHHHHHHHHHCCCCEECCCCEEEECCCCCCCEEEEEEECCCCCHHHHHHH
KTTDNYYFNASVTNDGDGSKDNPWKTINQLNFNKITNGSTVYISNGNYNVDNIDVNIDVN
CCCCCEEEEEEECCCCCCCCCCCCHHHCCCCCEEECCCCEEEEECCCEEEEEEEEEEEEE
IIGENTNKTIIKGYNTYDEVFNFNKHTTITNITFTNSSTKVIYNTGTLELNNCIFKNNNI
EEECCCCCEEEECCCCHHHHHCCCCCCEEEEEEEECCCCEEEEECCEEEECCEEEECCCC
TSYDACIKNNGKLTVNNCLFNNVSSQKSSVIYNSASNSINLYLKNSIFTNNNAYKGIVLL
EEEHHHCCCCCEEEEEEEEECCCCCCCCEEEEECCCCEEEEEEEEEEEECCCCCEEEEEE
YGSCAQLYNTTFNNNKATIMAGCIYLEKSSMNVNLSTFINNSVLKGTGGVFYVYDSDLFV
EECHHHHHCCCCCCCCEEEEEEEEEEEECCCEEEEEHEECCCEEECCCCEEEEEECCEEE
NNSIFSNNYALFGGVATFLNGSGDGEEITESKHNSTIINSSFTNNKVLYDGGVFFDVYSN
ECEEECCCEEEEECHHHEECCCCCCHHHHCCCCCCEEEECCCCCCEEEECCCEEEEEECC
LDIRSSNFTNNSARNGGSIYGDYSKININNTIFKNNTATYFGGSIYTNQIDIALNNNNFI
CEEECCCCCCCCCCCCCCEEECEEEEEECCEEEECCCCEEECCEEEEEEEEEEECCCCEE
NNKATKAEDVYSQYSRSFTSKNNTQTNTNSIITNQITTTKKPQVIITNLNNTPITTIPSS
CCCCCCHHHHHHHHHHHHCCCCCCCCCCCEEEEEEEECCCCCEEEEECCCCCCEEECCCC
YDLRKLNQVTSVKSQSGGGNCWSFATMGALESCILKATGISYDLSENNMKNIMALFSQSA
CCHHHHHHHHHHHCCCCCCCEEEHHHHHHHHHHHEEECCCEEECCCCCHHHHHHHHCCCC
WCISPNLGGYDEMPITYLINWYGPTDENNDPYIPEIIVSPQINNLIQINNVYGIPSRTNY
EEECCCCCCCCCCCEEEEEEEECCCCCCCCCCCCEEEECCCCCCEEEEEEEECCCCCCCC
TDNNEYKKAIMKYGAVYTDIYWLGSNVDNTHNSYYCHEKPEYTNHAVCIVGWDDNYNKNN
CCCHHHHHHHHHHCCEEEEEEEECCCCCCCCCCEEECCCCCCCCCEEEEEECCCCCCCCC
FITPAPGNGAFIIKNSWGTSSGENGYYYVSYYDESILNTCDDIYGAGGFTFIINNTETYD
EEECCCCCCEEEEEECCCCCCCCCCEEEEEEECCHHHHHHHHHHCCCCEEEEECCCCHHH
KIYQYDVGGISNWLESNKYGNYSNEYISSGNELIKAFGTYVSDLTNNYTVSIYVNNVLKH
HHEEECCCCHHHHHHCCCCCCCCHHHHHCCHHHHHHHHHHHHHCCCCEEEEEEEEHHHHH
TQKGLFTHLGYETVQVTKSINVKTNDKIKVVLELVSSSTVQIPISESKYTRIVSTTNSYV
HHHHHHHHCCCEEEEEEEEECCCCCCCEEEEEEECCCCEEEEEECCCCEEEEEEECCCEE
NGKTNSDSVACLKLYTSEINKSEVDAVVTKSNLTNTQLLINIHDTNGNSINTGTITIKEN
CCCCCCCCEEEEEEEHHHCCCCCCCEEEEECCCCCEEEEEEEECCCCCEEEEEEEEEECC
NTILKTVQVTSNQTYVDLGIKKGIHLITVCYNASNYAPSNTTLLLNIGATTINSDVLNSD
CEEEEEEEEECCCEEEEEECCCCEEEEEEEECCCCCCCCCCEEEEEECCEEECHHHHCCC
LKNTTIKVVVRDSNNNLVNSGRVVIYNNNNLLTNTTLINGQAIIVLNLNAGTQTLNILYL
CCCCEEEEEEECCCCCEEECCEEEEECCCCEEEEEEEECCCEEEEEEECCCCEEEEEEEE
DDNLYQSSNITQTITVKAIDTKMSVVAYSKLTTNSTIEVTVTDITGKLVTKGQVQIINQN
ECCCCCCCCCEEEEEEEEECCEEEEEEEEEECCCCEEEEEEEEECCEEEECCEEEEECCC
GQVIKTGTINNGRVNITLTSLPTGRQQYTAKYTEGTIYGNSSYTVIITVKTTDTKTTVKA
CCEEEEECCCCCEEEEEEEECCCCCHHEEEEEECCEEEECCCEEEEEEEEECCCCHHHHH
YSKLTTNSTIEVTVKDITGKLVTKGQVQIINQNGQVIKTGTINNGRVNITLTSLPTGRQQ
HHHHCCCCEEEEEEEECCCEEEECCEEEEECCCCCEEEEECCCCCEEEEEEEECCCCCHH
YTARYTEGTIYTQSQAGVIITVKTTDTKTTVKAYSKLTTNSTIEVTVTDITGKLVTKGQV
EEEEEECCEEEEECCCCEEEEEEECCCCHHHHHHHHHCCCCEEEEEEEEECCEEEECCEE
QIINQNGQVMKTGTINNGRVNITLTSLPTGRQQYTARYTEGTIYTQSQAGVIITVKTTDT
EEECCCCCEEEEECCCCCEEEEEEEECCCCCHHEEEEEECCEEEEECCCCEEEEEEECCC
KISVDVYKKYTTNTSMQITVKDITGKLVTKGQIQIINQNGQVIKTGTINNGRVNITLTSL
EEEEEEEEEECCCCEEEEEEEECCCEEEECCEEEEECCCCCEEEEECCCCCEEEEEEEEC
PTGSQKFIVKYTEGTIYTQSTYNITLTIIKDDTTTLTYKNIKTYNSNTTIDIRVNGGDNN
CCCCCEEEEEEECCEEEEEEEEEEEEEEEECCCEEEEEEEEEEECCCCEEEEEEECCCCC
QVTGKVQILNSRGRLLKSMTLKNGHAIITLGLPLGKQTLSIIYLGDKTHRLVNVSDTINV
EEEEEEEEECCCCCEEEEEEECCCCEEEEEECCCCCCEEEEEEECCCCCEEEEEHHHHHH
LNQTVKSYDSGNEIVLKKIITTSEKPDVEALGDDYQYVDDDGTYTITSSEILRVQRLDSL
HHHHHHHCCCCCEEEEEEECCCCCCCCHHHCCCCCEEECCCCCEEEEHHHHHHHHHHHHH
CQQIYGFMPKYTFFREEGSNIKYVIERSKWNVISRALNKYHVNKGFTAVNPPHALRITLK
HHHHHHCCCCEEEEECCCCCEEEEEEECCHHHHHHHHHHEECCCCCEECCCCCEEEEEEE
DKIRYYPVYYDSQEVIGGVRYTCGPTAMSMISQGLNKYNSERKLSNVYKTTRSEGTYESN
CCEEEEEEEECCHHHHCCEEEECCHHHHHHHHHHHHHHCCHHHHHHHHHHHCCCCCCCCC
IIKYSPSVNMTLIDIPDSKSAVISSIQSGAMVLWHIRGHYMNVIGYNSANDKFLCLNPSG
EEEECCCCCEEEEECCCCHHHHHHHHCCCCEEEEEEECEEEEEEEECCCCCEEEEECCCC
PSHNIEAVQWASWNTMMKTDRPLKGYGFMKVVPKWYITSSLNSQVKNYYMNMGGKYTTPN
CCCCCEEEEEECCCEEECCCCCCCCCCEEEECCCEEEECCHHHHHHHHHHHCCCEECCCC
NSEKLNTEDAVTYIV
CCCCCCCCCCEEEEC
>Mature Secondary Structure
MNKKILLTLLVIIMFFSISSVYAVDNSIDSSNTYSNLNTLKHTDTYQSSLIDNINENISS
CCCCHHHHHHHHHHHHHCCEEEEECCCCCCCCCCCCCCCEECCCHHHHHHHHHHHCCCCH
KTVEKEISVETKEKTEKSITKSDNKLNTNNYVVNKKSSDTQTKVDVISKDTSTKKVNKTL
HHEHHHCCCCCHHHHHHHHHCCCCEECCCCEEEECCCCCCCEEEEEEECCCCCHHHHHHH
KTTDNYYFNASVTNDGDGSKDNPWKTINQLNFNKITNGSTVYISNGNYNVDNIDVNIDVN
CCCCCEEEEEEECCCCCCCCCCCCHHHCCCCCEEECCCCEEEEECCCEEEEEEEEEEEEE
IIGENTNKTIIKGYNTYDEVFNFNKHTTITNITFTNSSTKVIYNTGTLELNNCIFKNNNI
EEECCCCCEEEECCCCHHHHHCCCCCCEEEEEEEECCCCEEEEECCEEEECCEEEECCCC
TSYDACIKNNGKLTVNNCLFNNVSSQKSSVIYNSASNSINLYLKNSIFTNNNAYKGIVLL
EEEHHHCCCCCEEEEEEEEECCCCCCCCEEEEECCCCEEEEEEEEEEEECCCCCEEEEEE
YGSCAQLYNTTFNNNKATIMAGCIYLEKSSMNVNLSTFINNSVLKGTGGVFYVYDSDLFV
EECHHHHHCCCCCCCCEEEEEEEEEEEECCCEEEEEHEECCCEEECCCCEEEEEECCEEE
NNSIFSNNYALFGGVATFLNGSGDGEEITESKHNSTIINSSFTNNKVLYDGGVFFDVYSN
ECEEECCCEEEEECHHHEECCCCCCHHHHCCCCCCEEEECCCCCCEEEECCCEEEEEECC
LDIRSSNFTNNSARNGGSIYGDYSKININNTIFKNNTATYFGGSIYTNQIDIALNNNNFI
CEEECCCCCCCCCCCCCCEEECEEEEEECCEEEECCCCEEECCEEEEEEEEEEECCCCEE
NNKATKAEDVYSQYSRSFTSKNNTQTNTNSIITNQITTTKKPQVIITNLNNTPITTIPSS
CCCCCCHHHHHHHHHHHHCCCCCCCCCCCEEEEEEEECCCCCEEEEECCCCCCEEECCCC
YDLRKLNQVTSVKSQSGGGNCWSFATMGALESCILKATGISYDLSENNMKNIMALFSQSA
CCHHHHHHHHHHHCCCCCCCEEEHHHHHHHHHHHEEECCCEEECCCCCHHHHHHHHCCCC
WCISPNLGGYDEMPITYLINWYGPTDENNDPYIPEIIVSPQINNLIQINNVYGIPSRTNY
EEECCCCCCCCCCCEEEEEEEECCCCCCCCCCCCEEEECCCCCCEEEEEEEECCCCCCCC
TDNNEYKKAIMKYGAVYTDIYWLGSNVDNTHNSYYCHEKPEYTNHAVCIVGWDDNYNKNN
CCCHHHHHHHHHHCCEEEEEEEECCCCCCCCCCEEECCCCCCCCCEEEEEECCCCCCCCC
FITPAPGNGAFIIKNSWGTSSGENGYYYVSYYDESILNTCDDIYGAGGFTFIINNTETYD
EEECCCCCCEEEEEECCCCCCCCCCEEEEEEECCHHHHHHHHHHCCCCEEEEECCCCHHH
KIYQYDVGGISNWLESNKYGNYSNEYISSGNELIKAFGTYVSDLTNNYTVSIYVNNVLKH
HHEEECCCCHHHHHHCCCCCCCCHHHHHCCHHHHHHHHHHHHHCCCCEEEEEEEEHHHHH
TQKGLFTHLGYETVQVTKSINVKTNDKIKVVLELVSSSTVQIPISESKYTRIVSTTNSYV
HHHHHHHHCCCEEEEEEEEECCCCCCCEEEEEEECCCCEEEEEECCCCEEEEEEECCCEE
NGKTNSDSVACLKLYTSEINKSEVDAVVTKSNLTNTQLLINIHDTNGNSINTGTITIKEN
CCCCCCCCEEEEEEEHHHCCCCCCCEEEEECCCCCEEEEEEEECCCCCEEEEEEEEEECC
NTILKTVQVTSNQTYVDLGIKKGIHLITVCYNASNYAPSNTTLLLNIGATTINSDVLNSD
CEEEEEEEEECCCEEEEEECCCCEEEEEEEECCCCCCCCCCEEEEEECCEEECHHHHCCC
LKNTTIKVVVRDSNNNLVNSGRVVIYNNNNLLTNTTLINGQAIIVLNLNAGTQTLNILYL
CCCCEEEEEEECCCCCEEECCEEEEECCCCEEEEEEEECCCEEEEEEECCCCEEEEEEEE
DDNLYQSSNITQTITVKAIDTKMSVVAYSKLTTNSTIEVTVTDITGKLVTKGQVQIINQN
ECCCCCCCCCEEEEEEEEECCEEEEEEEEEECCCCEEEEEEEEECCEEEECCEEEEECCC
GQVIKTGTINNGRVNITLTSLPTGRQQYTAKYTEGTIYGNSSYTVIITVKTTDTKTTVKA
CCEEEEECCCCCEEEEEEEECCCCCHHEEEEEECCEEEECCCEEEEEEEEECCCCHHHHH
YSKLTTNSTIEVTVKDITGKLVTKGQVQIINQNGQVIKTGTINNGRVNITLTSLPTGRQQ
HHHHCCCCEEEEEEEECCCEEEECCEEEEECCCCCEEEEECCCCCEEEEEEEECCCCCHH
YTARYTEGTIYTQSQAGVIITVKTTDTKTTVKAYSKLTTNSTIEVTVTDITGKLVTKGQV
EEEEEECCEEEEECCCCEEEEEEECCCCHHHHHHHHHCCCCEEEEEEEEECCEEEECCEE
QIINQNGQVMKTGTINNGRVNITLTSLPTGRQQYTARYTEGTIYTQSQAGVIITVKTTDT
EEECCCCCEEEEECCCCCEEEEEEEECCCCCHHEEEEEECCEEEEECCCCEEEEEEECCC
KISVDVYKKYTTNTSMQITVKDITGKLVTKGQIQIINQNGQVIKTGTINNGRVNITLTSL
EEEEEEEEEECCCCEEEEEEEECCCEEEECCEEEEECCCCCEEEEECCCCCEEEEEEEEC
PTGSQKFIVKYTEGTIYTQSTYNITLTIIKDDTTTLTYKNIKTYNSNTTIDIRVNGGDNN
CCCCCEEEEEEECCEEEEEEEEEEEEEEEECCCEEEEEEEEEEECCCCEEEEEEECCCCC
QVTGKVQILNSRGRLLKSMTLKNGHAIITLGLPLGKQTLSIIYLGDKTHRLVNVSDTINV
EEEEEEEEECCCCCEEEEEEECCCCEEEEEECCCCCCEEEEEEECCCCCEEEEEHHHHHH
LNQTVKSYDSGNEIVLKKIITTSEKPDVEALGDDYQYVDDDGTYTITSSEILRVQRLDSL
HHHHHHHCCCCCEEEEEEECCCCCCCCHHHCCCCCEEECCCCCEEEEHHHHHHHHHHHHH
CQQIYGFMPKYTFFREEGSNIKYVIERSKWNVISRALNKYHVNKGFTAVNPPHALRITLK
HHHHHHCCCCEEEEECCCCCEEEEEEECCHHHHHHHHHHEECCCCCEECCCCCEEEEEEE
DKIRYYPVYYDSQEVIGGVRYTCGPTAMSMISQGLNKYNSERKLSNVYKTTRSEGTYESN
CCEEEEEEEECCHHHHCCEEEECCHHHHHHHHHHHHHHCCHHHHHHHHHHHCCCCCCCCC
IIKYSPSVNMTLIDIPDSKSAVISSIQSGAMVLWHIRGHYMNVIGYNSANDKFLCLNPSG
EEEECCCCCEEEEECCCCHHHHHHHHCCCCEEEEEEECEEEEEEEECCCCCEEEEECCCC
PSHNIEAVQWASWNTMMKTDRPLKGYGFMKVVPKWYITSSLNSQVKNYYMNMGGKYTTPN
CCCCCEEEEEECCCEEECCCCCCCCCCEEEECCCEEEECCHHHHHHHHHHHCCCEECCCC
NSEKLNTEDAVTYIV
CCCCCCCCCCEEEEC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA