Definition Dehalococcoides ethenogenes 195, complete genome.
Accession NC_002936
Length 1,469,720

Click here to switch to the map view.

The map label for this gene is wapA [H]

Identifier: 57233842

GI number: 57233842

Start: 1326822

End: 1332326

Strand: Direct

Name: wapA [H]

Synonym: DET1472

Alternate gene names: 57233842

Gene position: 1326822-1332326 (Clockwise)

Preceding gene: 57233854

Following gene: 57233841

Centisome position: 90.28

GC content: 39.22

Gene sequence:

>5505_bases
GTGCCTGTTGAATCGAGTAAATTTGATAAAAAGACTGGCATATTGACAGCTTATCTTAATCATTTTAGCCACTATGGAGA
GCTGGCAAATCCTCTTATATCTGGGCCGGGCATGGTTATGGATTCTCAGGTCGGGCTACAATCTGGTGCATCGATTTACA
GCTACTCAATTGACACTCCTGCCGGACCTGGCGGTTTTAAACCCAAGATTGAATTAATCTACAATAGTGGTTCTGTAGAT
GAGATGAAAAACAAACGGTCGCTTGGCTCTTGGGTGGGTATTGGATGGAGTTTGAGCCTTGGCCGAATAACTCACGAACC
AATTGCTGACAAATACTTCCTCGAATTCAACAATGGTTCGTATGAACTCGTAACAGGTGATGGGATAAATTACTATACCA
AACCACAAGAATTTCTAAAGATAACCCGCTCTGGGGATATTTGGGAAGTCTATGATAAAAATGGCTACTATTATGAATTT
GGTGGTAGCACTGGATCTACCGCGGTACAATACCTGACCAGTGCAGATGGTGGAAGTTATCGCTGGGATTTAAGTATTAT
AAGGGATACCAATGGAAATGAAGCAACAGTCAGCTATATCCAAGATATAAAAGGCACTTCACCTGATACATGGGTAAGAT
CAGCTTATCCAGAGTATCTGACTTATGGCGATATTGTAATTCATTTTATATCATCATATGACCAGAATGATGCAACTGAT
GGCTATATTCGTTTGGATAATCCTAAAAGCTATGGATCCAATCCAGCTCCCAAGGTTATGGAAAATCGTAAGCTGGACGC
CATTGAAGTGAGCATAGGCGCTACCCTGATTCGCAAATATAGCTTTGCTTATACCGTTACTGCAGCTTCATATAATTCCA
GTCAATATGGTGGCATATATTATTCTGGTACTATCAAGCTTAACTCCATCATCCAAAAAGGTGCTGATGGCGTATCTTCT
TTACCAGCAACAACTTTCACTTATACGAATAAACAGGTATATAGGCGTACATATGAAACCACCTATAGTGGCAATCCTGG
CAATGCTGCTTCCTTATCATGGCCATTCCTTACACAGGTTAATAGCGGCTATGGTGGGTATGTGGCTTTTACTTATGTCC
AAACACCGGCTAACACCACATACGATACATGGACTAGAGAATGCGTTGCAACTAAGACTGTAAACAGCGGTATAGGCGTG
AGTCAAGTTACGAACTATGTTTATAGTGGCGGACCCTATTACTCCGGTTATGGCTGGGATGCTCCATTCAGAGGATTTAG
TTCAGTCAGAGAGATACCCGAAACTAACAGATTTATTAATCATAATTTTTATACAACTGGTTCGATTCTAGCCGAAAAAT
TGACCGGACTGGAATTTTCCTACAACTATTGCAAGTATAACGGCGCATTTAATGAAGAATACCCCGAAAGTGTTTCTTCA
GACTTTGAATCTGGGGCATTGGATGAAATAGTACTACGAATGGGTGGTGTACTTAGCAATACAATCTCCAGTTTGAATAA
TCCGAATGCAGTAGCAATTGGGCAAGATGGATATATCTATGTAGCAGATACTAATGCGAACCTAATCCGAAAGTATAATC
CTAATGGTATCCTTATGAGCAGCTTCGGCAATTCCTTAAACCAACCTCAAGGCTTAGCTTTTACTTATGATGGATATCTG
CTTGTTTCAAATACCAATGCCAATACTATTCAAAAATACACTATAGATGGGACTTTCGTAAGCAATTTAATTACTGGTCT
GACTCGTCCCCAAGGTATTACTGTAGCAAAAGGTGGAAACATATATGTTGCAAATACTGGAGCCAATAATGTCAAGATCT
ATACAGCTACAGGGAGCTTAGTCAATACAATTCTTTATTGGAATATGGGCACACAGTCCCTAAACCAACCCCAGGGTGTA
GCTGTAACCAACGATAACATCCTATTTGTAGCTGACACAGGAAATAACCGAATTCATATTTACTCAACTGTTAATAGTCC
TACAGTTAGTTTTGCCAGCTTCAATACCTACAAGTTTAATGGTGTGGATACTGCATTTAATGGACCCCAAGGGCTTTTCT
ATTCGCAAACAGGTTACTTATATGTTGCCGATACAGGAAACAATCTGGTCCATGAATATATTCCGGGGACTGGAATGACA
GATATACCAGAATGGGTAAGTAATATTGGAAGCGGGCTTAATCAACCTCAATCGGTAGCAGTAGCTCCTAATGGATATAT
ATATGTTACAGATACTGGTGATAATGAGATTCATAAATACGAATACACTATCCGAACTTGGATTATTCGGCTTGTAAAAT
ACACGATTGGATATAGTGGTACAGGCGGTTCCAATCACTATAATCAGGAACGATATGAATATGATAGCTATGGAAATGTA
ATCAAAAAATATCTGGATGGTAATCCGAATGCGATAGGTGATGAATCTTATATTGAATATGATTATTATCCAAATAGCAC
AGACAATATAGTAGGATTAGTAGCCAGAGAGCGGACTTTTGATAAAGATAGCAATCAAATAACTGAAACCCGCTACTATT
ATGACGGGAACAATACTGACTACACTACCCCACCTACCCAAGGAAACCTTACTCGTAAGGAATCCTTTATAGATGGCTCG
AGCTCAATTAGCAATTATTATACCTACGATACCTTTGGTAATGTACTAACAGAGCAGGATCCTAATGGAAATATTACCAG
TTGGGAATATGAAACAACATATAATACTTATCCTACAGTTAAGACTTATCCAATAACCGGATTGTCTGAAAGCTACACAT
TTGATCCAGGTACTGATAATCTTTTAACTAAAACGGATGTTAACGGACAAACAACCACCTGCTATTTTGATACATTTAAG
CGCATTACCAAAGTAGTAAAACCCGGTGATACGGAAACTCTTCCCAGTATAGAGTACCAATATAATAACTGGGGTACTAT
TAACCAGCAACACCTCAAAACTATTACCAGAATAAATTCAACAACCACTATATGGCAAAGCCAATACTTTGACGGTATCG
GTCGAGTAGTTCAGGTACAATCTCAGGGCGAAACCGGACGAACTATCATTGAACAAACTACAAAATATGATATCTGGGGC
CGAACTTCTCAAGTATATGTTCCTCAGGATTATGCCTCTACCTCAATAAATGGTTATAAAGCACCTGAAACCGCATGGAA
ATCTGTTTCATATATCTATGATATACTTGGCCGTTTGATAACCCAAATAAATGCTGATGCCACAACAGTTAGTTATGATA
GAGCAACAGTCAGTCTGCAGGTACTGGTAACTAATGAACGCGGTTATAAACATCGCTATTACTACGATTCATACTTACGT
CTAACAAAAGTTGTGGAATATGATGCTAATAACGCTATTTACGCTACCACTGAATACACATATGATACACTGGGTAATCT
TACGCAGGTTAAGGATAATTCCAACAATATAACAAGCATTAGTTATGATTGGTTAAATCGTAAAACGGGTATGATGGATC
CTGATATGGGAAGCTGGGTCTATGGCTATGACAATAACGGTAACATCATCAGCCAAACTGATGCCTTGAGCCATACTATT
AGCTATGCTTATGATGCTTTGAATCGTCTCACTTCCAAGACATACCCCGCAGGTTTGGGTATGACCGATGTCAGCTATAA
TTATGATAGCACTGCCAATGGTAACTATGGCTTGGGTTTGCGCACTAGTATGACTGATGCTGTTGGTACAATTGTTTGGA
CTTATGATTCATGGGGTAGAAACATTGAAGAACTTCGGACAATAGATTCCGTAGATTACGCTACTTCTTATATTTATGAT
GGTTTAAACCGAATAACAACAATCACATATCCTACAGGAGAAGTTGTTACCAATACCTATAATGGACGAGGTCTACCTTA
TGCCCTGAGTGGTAGTACTACAGGTAATTTGGTAACTAGTACGCTATACAACCAACTGGCTCAGCCTAAAGAAATTAACT
TTGGCAACACCTTACGAACTACTTTTGGTTACTATGGTCTGGGTGGTAGTTATGATACTACCGGTGGTTATTACGGTAAC
CTGTGGGAGATAAAAACTTTACCTCAGAGTGGTGGTAATGTTTTGCAGGATACTCGCTATACCTGGGATGCAGGTGATAA
TGTATCCACTAGGCAAGATGTTTTATCAAGTCAGACTGAAACATTTACATATGATTTCCTGGGTCGTTTAACTGCTGTTT
CGGGTGCTTATATTGCCTCATACAGTTATAATCAGATAGGTAATATTGTAGCCATGAATGGTTCCTCATACACTTATAGC
ACTCAGCCTCATGCCGTAACACAAGTAGGCACCACCAATTATCTCTATGATGCTAATGGCAACATGACCAATCGAGGCAC
TCAAACCTTGACTTGGGATCTTGAAAATAGGCCGGTTAGTATTACCGAAGGTGGCGATATTACTACTTTTATTTACGATG
GTGATGGCAATAGGATTAAACAAATAACCTCAATTGAAACTATTTTGTATATAAACAAATTTTATGAAAAAAACCTTGCC
ACAGATGAGGTAACCACTCGGTATTATTTTGGGGACACAATGATGGCAGAACGACAAGGTACAACTCTCAGGTATGTTCA
TCAGGATAGTATTAACAGCACCAGTTTGGTCACTAGCAATACTGGTACTGCGCTTGGCTCAACCAAGTATTATCCGTATG
GTGTTACCAGAAGCGGTTCTGTTCCTGTTGATGAGCAGTTTACCGGCCAGAAGCTTGATGGTACCGGGCTATATTATTAT
AATGCTCGCTATTATGATCCAACGCTTGGTAGATTTTTAAGTGCCGATATATACATTCAAGATTTTACGAATCCCCAGTG
TTTAAACAGGTATTCTTACTGCCAGAATAATCCTTTAAAATATACTGATCCCAGTGGACATTTTGCTTGGTTTTTACCGA
TTATCGGAGCAGCTATTGGAGCTGTAGCAGGTGCGGTTAAAACCGTTGTAGATTGTGCAATACACCCGGAGAAAGCGTTT
TCAACTAAAGAATTAATAGCCAATGTAGTTGGAGGAGCAGTTGCTGGTGCGCTAGCATTTACAGGGATTGGTATTTTAGC
TGATATTACAGCAGAAGTTAGTACCGCATTTGTAGTAGTGGCAAACCTAGCAGTATCAGAAGTATCTAATGTGGTTGACT
CGGTAATTGAATCAGCTATGACGGGCGAAGATTATACTATTAATGATTTAACTACAGATGTTATTTCTGGTGCTCTAACA
GGGCCTGCAGGAGTAGGTATAGCTCCATCACTTAATAAAATAATAACAAATAAGGAAGTAGTTGCCGGTGTAATAACTTC
CGGTTTTCAGATTTTTACCAATACAATAAGGTCTATTTTTGGACTCACTAATAACGTGAATAGTGGAAAAAGTAAAAGGA
ATAGCGATATAAATTCTGGTCTTGTGTTTTATGGGACTAGCAGGCCTTCGGTGCAGTTATTATAA

Upstream 100 bases:

>100_bases
CAGCTTCTTATAACGATCAAGCATACCCCAGAAGAATTACATGGTTTAGACTTAGATTCACTTAAGCTATGCTATTTAGA
TGAAAAAGAATTAATCCTGG

Downstream 100 bases:

>100_bases
TGCTCATATAGCCTAACAAGTAGCAAAATCCTATACAACAAATGTCGCGCTTTTTATGACGAAATATTACCCAATTGATT
TGTGGATAAAGATTTATGAG

Product: NHL/RHS/YD repeat-containing protein

Products: NA

Alternate protein names: Cell wall-associated polypeptide CWBP200; CWBP200 [H]

Number of amino acids: Translated: 1834; Mature: 1833

Protein sequence:

>1834_residues
MPVESSKFDKKTGILTAYLNHFSHYGELANPLISGPGMVMDSQVGLQSGASIYSYSIDTPAGPGGFKPKIELIYNSGSVD
EMKNKRSLGSWVGIGWSLSLGRITHEPIADKYFLEFNNGSYELVTGDGINYYTKPQEFLKITRSGDIWEVYDKNGYYYEF
GGSTGSTAVQYLTSADGGSYRWDLSIIRDTNGNEATVSYIQDIKGTSPDTWVRSAYPEYLTYGDIVIHFISSYDQNDATD
GYIRLDNPKSYGSNPAPKVMENRKLDAIEVSIGATLIRKYSFAYTVTAASYNSSQYGGIYYSGTIKLNSIIQKGADGVSS
LPATTFTYTNKQVYRRTYETTYSGNPGNAASLSWPFLTQVNSGYGGYVAFTYVQTPANTTYDTWTRECVATKTVNSGIGV
SQVTNYVYSGGPYYSGYGWDAPFRGFSSVREIPETNRFINHNFYTTGSILAEKLTGLEFSYNYCKYNGAFNEEYPESVSS
DFESGALDEIVLRMGGVLSNTISSLNNPNAVAIGQDGYIYVADTNANLIRKYNPNGILMSSFGNSLNQPQGLAFTYDGYL
LVSNTNANTIQKYTIDGTFVSNLITGLTRPQGITVAKGGNIYVANTGANNVKIYTATGSLVNTILYWNMGTQSLNQPQGV
AVTNDNILFVADTGNNRIHIYSTVNSPTVSFASFNTYKFNGVDTAFNGPQGLFYSQTGYLYVADTGNNLVHEYIPGTGMT
DIPEWVSNIGSGLNQPQSVAVAPNGYIYVTDTGDNEIHKYEYTIRTWIIRLVKYTIGYSGTGGSNHYNQERYEYDSYGNV
IKKYLDGNPNAIGDESYIEYDYYPNSTDNIVGLVARERTFDKDSNQITETRYYYDGNNTDYTTPPTQGNLTRKESFIDGS
SSISNYYTYDTFGNVLTEQDPNGNITSWEYETTYNTYPTVKTYPITGLSESYTFDPGTDNLLTKTDVNGQTTTCYFDTFK
RITKVVKPGDTETLPSIEYQYNNWGTINQQHLKTITRINSTTTIWQSQYFDGIGRVVQVQSQGETGRTIIEQTTKYDIWG
RTSQVYVPQDYASTSINGYKAPETAWKSVSYIYDILGRLITQINADATTVSYDRATVSLQVLVTNERGYKHRYYYDSYLR
LTKVVEYDANNAIYATTEYTYDTLGNLTQVKDNSNNITSISYDWLNRKTGMMDPDMGSWVYGYDNNGNIISQTDALSHTI
SYAYDALNRLTSKTYPAGLGMTDVSYNYDSTANGNYGLGLRTSMTDAVGTIVWTYDSWGRNIEELRTIDSVDYATSYIYD
GLNRITTITYPTGEVVTNTYNGRGLPYALSGSTTGNLVTSTLYNQLAQPKEINFGNTLRTTFGYYGLGGSYDTTGGYYGN
LWEIKTLPQSGGNVLQDTRYTWDAGDNVSTRQDVLSSQTETFTYDFLGRLTAVSGAYIASYSYNQIGNIVAMNGSSYTYS
TQPHAVTQVGTTNYLYDANGNMTNRGTQTLTWDLENRPVSITEGGDITTFIYDGDGNRIKQITSIETILYINKFYEKNLA
TDEVTTRYYFGDTMMAERQGTTLRYVHQDSINSTSLVTSNTGTALGSTKYYPYGVTRSGSVPVDEQFTGQKLDGTGLYYY
NARYYDPTLGRFLSADIYIQDFTNPQCLNRYSYCQNNPLKYTDPSGHFAWFLPIIGAAIGAVAGAVKTVVDCAIHPEKAF
STKELIANVVGGAVAGALAFTGIGILADITAEVSTAFVVVANLAVSEVSNVVDSVIESAMTGEDYTINDLTTDVISGALT
GPAGVGIAPSLNKIITNKEVVAGVITSGFQIFTNTIRSIFGLTNNVNSGKSKRNSDINSGLVFYGTSRPSVQLL

Sequences:

>Translated_1834_residues
MPVESSKFDKKTGILTAYLNHFSHYGELANPLISGPGMVMDSQVGLQSGASIYSYSIDTPAGPGGFKPKIELIYNSGSVD
EMKNKRSLGSWVGIGWSLSLGRITHEPIADKYFLEFNNGSYELVTGDGINYYTKPQEFLKITRSGDIWEVYDKNGYYYEF
GGSTGSTAVQYLTSADGGSYRWDLSIIRDTNGNEATVSYIQDIKGTSPDTWVRSAYPEYLTYGDIVIHFISSYDQNDATD
GYIRLDNPKSYGSNPAPKVMENRKLDAIEVSIGATLIRKYSFAYTVTAASYNSSQYGGIYYSGTIKLNSIIQKGADGVSS
LPATTFTYTNKQVYRRTYETTYSGNPGNAASLSWPFLTQVNSGYGGYVAFTYVQTPANTTYDTWTRECVATKTVNSGIGV
SQVTNYVYSGGPYYSGYGWDAPFRGFSSVREIPETNRFINHNFYTTGSILAEKLTGLEFSYNYCKYNGAFNEEYPESVSS
DFESGALDEIVLRMGGVLSNTISSLNNPNAVAIGQDGYIYVADTNANLIRKYNPNGILMSSFGNSLNQPQGLAFTYDGYL
LVSNTNANTIQKYTIDGTFVSNLITGLTRPQGITVAKGGNIYVANTGANNVKIYTATGSLVNTILYWNMGTQSLNQPQGV
AVTNDNILFVADTGNNRIHIYSTVNSPTVSFASFNTYKFNGVDTAFNGPQGLFYSQTGYLYVADTGNNLVHEYIPGTGMT
DIPEWVSNIGSGLNQPQSVAVAPNGYIYVTDTGDNEIHKYEYTIRTWIIRLVKYTIGYSGTGGSNHYNQERYEYDSYGNV
IKKYLDGNPNAIGDESYIEYDYYPNSTDNIVGLVARERTFDKDSNQITETRYYYDGNNTDYTTPPTQGNLTRKESFIDGS
SSISNYYTYDTFGNVLTEQDPNGNITSWEYETTYNTYPTVKTYPITGLSESYTFDPGTDNLLTKTDVNGQTTTCYFDTFK
RITKVVKPGDTETLPSIEYQYNNWGTINQQHLKTITRINSTTTIWQSQYFDGIGRVVQVQSQGETGRTIIEQTTKYDIWG
RTSQVYVPQDYASTSINGYKAPETAWKSVSYIYDILGRLITQINADATTVSYDRATVSLQVLVTNERGYKHRYYYDSYLR
LTKVVEYDANNAIYATTEYTYDTLGNLTQVKDNSNNITSISYDWLNRKTGMMDPDMGSWVYGYDNNGNIISQTDALSHTI
SYAYDALNRLTSKTYPAGLGMTDVSYNYDSTANGNYGLGLRTSMTDAVGTIVWTYDSWGRNIEELRTIDSVDYATSYIYD
GLNRITTITYPTGEVVTNTYNGRGLPYALSGSTTGNLVTSTLYNQLAQPKEINFGNTLRTTFGYYGLGGSYDTTGGYYGN
LWEIKTLPQSGGNVLQDTRYTWDAGDNVSTRQDVLSSQTETFTYDFLGRLTAVSGAYIASYSYNQIGNIVAMNGSSYTYS
TQPHAVTQVGTTNYLYDANGNMTNRGTQTLTWDLENRPVSITEGGDITTFIYDGDGNRIKQITSIETILYINKFYEKNLA
TDEVTTRYYFGDTMMAERQGTTLRYVHQDSINSTSLVTSNTGTALGSTKYYPYGVTRSGSVPVDEQFTGQKLDGTGLYYY
NARYYDPTLGRFLSADIYIQDFTNPQCLNRYSYCQNNPLKYTDPSGHFAWFLPIIGAAIGAVAGAVKTVVDCAIHPEKAF
STKELIANVVGGAVAGALAFTGIGILADITAEVSTAFVVVANLAVSEVSNVVDSVIESAMTGEDYTINDLTTDVISGALT
GPAGVGIAPSLNKIITNKEVVAGVITSGFQIFTNTIRSIFGLTNNVNSGKSKRNSDINSGLVFYGTSRPSVQLL
>Mature_1833_residues
PVESSKFDKKTGILTAYLNHFSHYGELANPLISGPGMVMDSQVGLQSGASIYSYSIDTPAGPGGFKPKIELIYNSGSVDE
MKNKRSLGSWVGIGWSLSLGRITHEPIADKYFLEFNNGSYELVTGDGINYYTKPQEFLKITRSGDIWEVYDKNGYYYEFG
GSTGSTAVQYLTSADGGSYRWDLSIIRDTNGNEATVSYIQDIKGTSPDTWVRSAYPEYLTYGDIVIHFISSYDQNDATDG
YIRLDNPKSYGSNPAPKVMENRKLDAIEVSIGATLIRKYSFAYTVTAASYNSSQYGGIYYSGTIKLNSIIQKGADGVSSL
PATTFTYTNKQVYRRTYETTYSGNPGNAASLSWPFLTQVNSGYGGYVAFTYVQTPANTTYDTWTRECVATKTVNSGIGVS
QVTNYVYSGGPYYSGYGWDAPFRGFSSVREIPETNRFINHNFYTTGSILAEKLTGLEFSYNYCKYNGAFNEEYPESVSSD
FESGALDEIVLRMGGVLSNTISSLNNPNAVAIGQDGYIYVADTNANLIRKYNPNGILMSSFGNSLNQPQGLAFTYDGYLL
VSNTNANTIQKYTIDGTFVSNLITGLTRPQGITVAKGGNIYVANTGANNVKIYTATGSLVNTILYWNMGTQSLNQPQGVA
VTNDNILFVADTGNNRIHIYSTVNSPTVSFASFNTYKFNGVDTAFNGPQGLFYSQTGYLYVADTGNNLVHEYIPGTGMTD
IPEWVSNIGSGLNQPQSVAVAPNGYIYVTDTGDNEIHKYEYTIRTWIIRLVKYTIGYSGTGGSNHYNQERYEYDSYGNVI
KKYLDGNPNAIGDESYIEYDYYPNSTDNIVGLVARERTFDKDSNQITETRYYYDGNNTDYTTPPTQGNLTRKESFIDGSS
SISNYYTYDTFGNVLTEQDPNGNITSWEYETTYNTYPTVKTYPITGLSESYTFDPGTDNLLTKTDVNGQTTTCYFDTFKR
ITKVVKPGDTETLPSIEYQYNNWGTINQQHLKTITRINSTTTIWQSQYFDGIGRVVQVQSQGETGRTIIEQTTKYDIWGR
TSQVYVPQDYASTSINGYKAPETAWKSVSYIYDILGRLITQINADATTVSYDRATVSLQVLVTNERGYKHRYYYDSYLRL
TKVVEYDANNAIYATTEYTYDTLGNLTQVKDNSNNITSISYDWLNRKTGMMDPDMGSWVYGYDNNGNIISQTDALSHTIS
YAYDALNRLTSKTYPAGLGMTDVSYNYDSTANGNYGLGLRTSMTDAVGTIVWTYDSWGRNIEELRTIDSVDYATSYIYDG
LNRITTITYPTGEVVTNTYNGRGLPYALSGSTTGNLVTSTLYNQLAQPKEINFGNTLRTTFGYYGLGGSYDTTGGYYGNL
WEIKTLPQSGGNVLQDTRYTWDAGDNVSTRQDVLSSQTETFTYDFLGRLTAVSGAYIASYSYNQIGNIVAMNGSSYTYST
QPHAVTQVGTTNYLYDANGNMTNRGTQTLTWDLENRPVSITEGGDITTFIYDGDGNRIKQITSIETILYINKFYEKNLAT
DEVTTRYYFGDTMMAERQGTTLRYVHQDSINSTSLVTSNTGTALGSTKYYPYGVTRSGSVPVDEQFTGQKLDGTGLYYYN
ARYYDPTLGRFLSADIYIQDFTNPQCLNRYSYCQNNPLKYTDPSGHFAWFLPIIGAAIGAVAGAVKTVVDCAIHPEKAFS
TKELIANVVGGAVAGALAFTGIGILADITAEVSTAFVVVANLAVSEVSNVVDSVIESAMTGEDYTINDLTTDVISGALTG
PAGVGIAPSLNKIITNKEVVAGVITSGFQIFTNTIRSIFGLTNNVNSGKSKRNSDINSGLVFYGTSRPSVQLL

Specific function: Still unknown. Not involved in cell membrane metabolism, motility, secretion or differentiation [H]

COG id: COG3209

COG function: function code M; Rhs family protein

Gene ontology:

Cell location: Secreted, cell wall. Note=Released into the medium [H]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

Organism=Homo sapiens, GI84993742, Length=267, Percent_Identity=26.5917602996255, Blast_Score=96, Evalue=2e-19,
Organism=Homo sapiens, GI194248079, Length=283, Percent_Identity=24.3816254416961, Blast_Score=90, Evalue=2e-17,
Organism=Homo sapiens, GI194248081, Length=283, Percent_Identity=24.3816254416961, Blast_Score=89, Evalue=3e-17,
Organism=Homo sapiens, GI32454739, Length=283, Percent_Identity=25.7950530035336, Blast_Score=84, Evalue=9e-16,
Organism=Homo sapiens, GI32454737, Length=283, Percent_Identity=25.7950530035336, Blast_Score=84, Evalue=9e-16,
Organism=Caenorhabditis elegans, GI71980713, Length=308, Percent_Identity=22.7272727272727, Blast_Score=76, Evalue=1e-13,
Organism=Caenorhabditis elegans, GI71980716, Length=308, Percent_Identity=22.7272727272727, Blast_Score=76, Evalue=2e-13,
Organism=Caenorhabditis elegans, GI17553622, Length=172, Percent_Identity=27.906976744186, Blast_Score=71, Evalue=7e-12,
Organism=Drosophila melanogaster, GI24655386, Length=267, Percent_Identity=27.7153558052434, Blast_Score=96, Evalue=2e-19,
Organism=Drosophila melanogaster, GI22024206, Length=267, Percent_Identity=27.7153558052434, Blast_Score=96, Evalue=2e-19,
Organism=Drosophila melanogaster, GI221330419, Length=270, Percent_Identity=27.7777777777778, Blast_Score=96, Evalue=3e-19,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR008979
- InterPro:   IPR022385
- InterPro:   IPR006530 [H]

Pfam domain/function: PF05593 RHS_repeat [H]

EC number: NA

Molecular weight: Translated: 202425; Mature: 202294

Theoretical pI: Translated: 4.62; Mature: 4.62

Prosite motif: PS51125 NHL L=RR

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.3 %Cys     (Translated Protein)
1.0 %Met     (Translated Protein)
1.4 %Cys+Met (Translated Protein)
0.3 %Cys     (Mature Protein)
1.0 %Met     (Mature Protein)
1.3 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MPVESSKFDKKTGILTAYLNHFSHYGELANPLISGPGMVMDSQVGLQSGASIYSYSIDTP
CCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEECCCCCCCCCEEEEEECCCC
AGPGGFKPKIELIYNSGSVDEMKNKRSLGSWVGIGWSLSLGRITHEPIADKYFLEFNNGS
CCCCCCCCEEEEEECCCCHHHHHHHHCCCCEEECCEEEEECCEECCCCCCEEEEEECCCC
YELVTGDGINYYTKPQEFLKITRSGDIWEVYDKNGYYYEFGGSTGSTAVQYLTSADGGSY
EEEEECCCCCCCCCCHHHHEECCCCCEEEEEECCCEEEEECCCCCCHHHHHEECCCCCCE
RWDLSIIRDTNGNEATVSYIQDIKGTSPDTWVRSAYPEYLTYGDIVIHFISSYDQNDATD
EEEEEEEEECCCCHHHHHHHHHHCCCCCCHHHHHCCCCHHHHHHHHHHHHHCCCCCCCCC
GYIRLDNPKSYGSNPAPKVMENRKLDAIEVSIGATLIRKYSFAYTVTAASYNSSQYGGIY
CEEEECCCCCCCCCCCCHHHHCCCCCEEEEEHHHHHHHHEEEEEEEEEECCCCCCCCCEE
YSGTIKLNSIIQKGADGVSSLPATTFTYTNKQVYRRTYETTYSGNPGNAASLSWPFLTQV
EEEEEEEHHHHHCCCCCCCCCCCEEEEECCHHHHHHHHHEEECCCCCCCCEECCCHHEEE
NSGYGGYVAFTYVQTPANTTYDTWTRECVATKTVNSGIGVSQVTNYVYSGGPYYSGYGWD
CCCCCCEEEEEEEECCCCCCHHHHHHHHHEEEECCCCCCHHHHHHHHCCCCCCCCCCCCC
APFRGFSSVREIPETNRFINHNFYTTGSILAEKLTGLEFSYNYCKYNGAFNEEYPESVSS
CCCCCHHHHHHCCCCCCEECCCEEEHHHHHHHHHCCCEEEEEEEEECCCCCCCCCHHHHC
DFESGALDEIVLRMGGVLSNTISSLNNPNAVAIGQDGYIYVADTNANLIRKYNPNGILMS
CCCCCCHHHHHHHHCHHHHHHHHHCCCCCEEEECCCCEEEEEECCCCEEEEECCCCEEEE
SFGNSLNQPQGLAFTYDGYLLVSNTNANTIQKYTIDGTFVSNLITGLTRPQGITVAKGGN
CCCCCCCCCCCEEEEECCEEEEECCCCCEEEEEEECHHHHHHHHHHCCCCCCEEEEECCC
IYVANTGANNVKIYTATGSLVNTILYWNMGTQSLNQPQGVAVTNDNILFVADTGNNRIHI
EEEEECCCCCEEEEEECCHHEEEEEEEECCCCCCCCCCCEEEECCCEEEEEECCCCEEEE
YSTVNSPTVSFASFNTYKFNGVDTAFNGPQGLFYSQTGYLYVADTGNNLVHEYIPGTGMT
EEECCCCEEEEEECCEEEECCCCCCCCCCCCEEEECCCEEEEEECCCCEEHHHCCCCCCC
DIPEWVSNIGSGLNQPQSVAVAPNGYIYVTDTGDNEIHKYEYTIRTWIIRLVKYTIGYSG
HHHHHHHHHHCCCCCCCEEEECCCCEEEEEECCCCCEEEEEHHHHHHHHHHHHHHHCCCC
TGGSNHYNQERYEYDSYGNVIKKYLDGNPNAIGDESYIEYDYYPNSTDNIVGLVARERTF
CCCCCCCCCHHHCHHHHHHHHHHHHCCCCCCCCCCCEEEEECCCCCCCCEEEEEEECCCC
DKDSNQITETRYYYDGNNTDYTTPPTQGNLTRKESFIDGSSSISNYYTYDTFGNVLTEQD
CCCCCCEEEEEEEECCCCCCCCCCCCCCCCCHHHHCCCCCCCCCCCEEEHHHCCHHCCCC
PNGNITSWEYETTYNTYPTVKTYPITGLSESYTFDPGTDNLLTKTDVNGQTTTCYFDTFK
CCCCEEEEEEEEECCCCCCEEEEECCCCCCCCCCCCCCCCCEEEECCCCCEEEEHHHHHH
RITKVVKPGDTETLPSIEYQYNNWGTINQQHLKTITRINSTTTIWQSQYFDGIGRVVQVQ
HHHHHHCCCCCCCCCCEEEEECCCCCCCHHHHHHHHHCCCCEEEHHHHHHHCCCEEEEEE
SQGETGRTIIEQTTKYDIWGRTSQVYVPQDYASTSINGYKAPETAWKSVSYIYDILGRLI
CCCCCCCHHHHHCCEEEECCCCEEEEECCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHH
TQINADATTVSYDRATVSLQVLVTNERGYKHRYYYDSYLRLTKVVEYDANNAIYATTEYT
HHCCCCCEEEEECCEEEEEEEEEECCCCCEEEEEEHHHHEEEHEEEECCCCEEEEEECCC
YDTLGNLTQVKDNSNNITSISYDWLNRKTGMMDPDMGSWVYGYDNNGNIISQTDALSHTI
HHHHCCEEEECCCCCCEEEEEEHHHCCCCCCCCCCCCCEEEEECCCCCEEECCHHHHHHH
SYAYDALNRLTSKTYPAGLGMTDVSYNYDSTANGNYGLGLRTSMTDAVGTIVWTYDSWGR
HHHHHHHHHHHCCCCCCCCCCEEEECCCCCCCCCCCCCEECCCCCCCCEEEEEEECCCCC
NIEELRTIDSVDYATSYIYDGLNRITTITYPTGEVVTNTYNGRGLPYALSGSTTGNLVTS
CHHHHHHHCCHHHHHHHHHHCCCCEEEEEECCCCEEEECCCCCCCCEEECCCCCCHHHHH
TLYNQLAQPKEINFGNTLRTTFGYYGLGGSYDTTGGYYGNLWEIKTLPQSGGNVLQDTRY
HHHHHHCCCCCCCCCCCHHHHCCEECCCCCCCCCCCCCCCEEEEEECCCCCCCCCCCCCE
TWDAGDNVSTRQDVLSSQTETFTYDFLGRLTAVSGAYIASYSYNQIGNIVAMNGSSYTYS
EECCCCCCCHHHHHHCCCCCEEEHHHHHHHHHHCCEEEEEECHHHCCCEEEECCCCEEEC
TQPHAVTQVGTTNYLYDANGNMTNRGTQTLTWDLENRPVSITEGGDITTFIYDGDGNRIK
CCCCEEEEECCCEEEECCCCCCCCCCCEEEEEEECCCCEEEECCCCEEEEEEECCCCCEE
QITSIETILYINKFYEKNLATDEVTTRYYFGDTMMAERQGTTLRYVHQDSINSTSLVTSN
HHHHHHHHHHHHHHHHCCCCCCCEEEEEEECCCEEECCCCCEEEEEECCCCCCCEEEECC
TGTALGSTKYYPYGVTRSGSVPVDEQFTGQKLDGTGLYYYNARYYDPTLGRFLSADIYIQ
CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCEECCCEEEEEEEEEECCHHHHHEECEEEEE
DFTNPQCLNRYSYCQNNPLKYTDPSGHFAWFLPIIGAAIGAVAGAVKTVVDCAIHPEKAF
ECCCHHHHHHHHHHCCCCCEECCCCCCEEEHHHHHHHHHHHHHHHHHHHHHHHCCCHHHC
STKELIANVVGGAVAGALAFTGIGILADITAEVSTAFVVVANLAVSEVSNVVDSVIESAM
CHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHEEHHHHHHHHHHHHHHHHHHHHHHH
TGEDYTINDLTTDVISGALTGPAGVGIAPSLNKIITNKEVVAGVITSGFQIFTNTIRSIF
CCCCEEEHHHHHHHHHCCCCCCCCCCCCCCHHHHHCCHHHHHHHHHCCHHHHHHHHHHHH
GLTNNVNSGKSKRNSDINSGLVFYGTSRPSVQLL
CCCCCCCCCCCCCCCCCCCCEEEEECCCCCEEEC
>Mature Secondary Structure 
PVESSKFDKKTGILTAYLNHFSHYGELANPLISGPGMVMDSQVGLQSGASIYSYSIDTP
CCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEECCCCCCCCCEEEEEECCCC
AGPGGFKPKIELIYNSGSVDEMKNKRSLGSWVGIGWSLSLGRITHEPIADKYFLEFNNGS
CCCCCCCCEEEEEECCCCHHHHHHHHCCCCEEECCEEEEECCEECCCCCCEEEEEECCCC
YELVTGDGINYYTKPQEFLKITRSGDIWEVYDKNGYYYEFGGSTGSTAVQYLTSADGGSY
EEEEECCCCCCCCCCHHHHEECCCCCEEEEEECCCEEEEECCCCCCHHHHHEECCCCCCE
RWDLSIIRDTNGNEATVSYIQDIKGTSPDTWVRSAYPEYLTYGDIVIHFISSYDQNDATD
EEEEEEEEECCCCHHHHHHHHHHCCCCCCHHHHHCCCCHHHHHHHHHHHHHCCCCCCCCC
GYIRLDNPKSYGSNPAPKVMENRKLDAIEVSIGATLIRKYSFAYTVTAASYNSSQYGGIY
CEEEECCCCCCCCCCCCHHHHCCCCCEEEEEHHHHHHHHEEEEEEEEEECCCCCCCCCEE
YSGTIKLNSIIQKGADGVSSLPATTFTYTNKQVYRRTYETTYSGNPGNAASLSWPFLTQV
EEEEEEEHHHHHCCCCCCCCCCCEEEEECCHHHHHHHHHEEECCCCCCCCEECCCHHEEE
NSGYGGYVAFTYVQTPANTTYDTWTRECVATKTVNSGIGVSQVTNYVYSGGPYYSGYGWD
CCCCCCEEEEEEEECCCCCCHHHHHHHHHEEEECCCCCCHHHHHHHHCCCCCCCCCCCCC
APFRGFSSVREIPETNRFINHNFYTTGSILAEKLTGLEFSYNYCKYNGAFNEEYPESVSS
CCCCCHHHHHHCCCCCCEECCCEEEHHHHHHHHHCCCEEEEEEEEECCCCCCCCCHHHHC
DFESGALDEIVLRMGGVLSNTISSLNNPNAVAIGQDGYIYVADTNANLIRKYNPNGILMS
CCCCCCHHHHHHHHCHHHHHHHHHCCCCCEEEECCCCEEEEEECCCCEEEEECCCCEEEE
SFGNSLNQPQGLAFTYDGYLLVSNTNANTIQKYTIDGTFVSNLITGLTRPQGITVAKGGN
CCCCCCCCCCCEEEEECCEEEEECCCCCEEEEEEECHHHHHHHHHHCCCCCCEEEEECCC
IYVANTGANNVKIYTATGSLVNTILYWNMGTQSLNQPQGVAVTNDNILFVADTGNNRIHI
EEEEECCCCCEEEEEECCHHEEEEEEEECCCCCCCCCCCEEEECCCEEEEEECCCCEEEE
YSTVNSPTVSFASFNTYKFNGVDTAFNGPQGLFYSQTGYLYVADTGNNLVHEYIPGTGMT
EEECCCCEEEEEECCEEEECCCCCCCCCCCCEEEECCCEEEEEECCCCEEHHHCCCCCCC
DIPEWVSNIGSGLNQPQSVAVAPNGYIYVTDTGDNEIHKYEYTIRTWIIRLVKYTIGYSG
HHHHHHHHHHCCCCCCCEEEECCCCEEEEEECCCCCEEEEEHHHHHHHHHHHHHHHCCCC
TGGSNHYNQERYEYDSYGNVIKKYLDGNPNAIGDESYIEYDYYPNSTDNIVGLVARERTF
CCCCCCCCCHHHCHHHHHHHHHHHHCCCCCCCCCCCEEEEECCCCCCCCEEEEEEECCCC
DKDSNQITETRYYYDGNNTDYTTPPTQGNLTRKESFIDGSSSISNYYTYDTFGNVLTEQD
CCCCCCEEEEEEEECCCCCCCCCCCCCCCCCHHHHCCCCCCCCCCCEEEHHHCCHHCCCC
PNGNITSWEYETTYNTYPTVKTYPITGLSESYTFDPGTDNLLTKTDVNGQTTTCYFDTFK
CCCCEEEEEEEEECCCCCCEEEEECCCCCCCCCCCCCCCCCEEEECCCCCEEEEHHHHHH
RITKVVKPGDTETLPSIEYQYNNWGTINQQHLKTITRINSTTTIWQSQYFDGIGRVVQVQ
HHHHHHCCCCCCCCCCEEEEECCCCCCCHHHHHHHHHCCCCEEEHHHHHHHCCCEEEEEE
SQGETGRTIIEQTTKYDIWGRTSQVYVPQDYASTSINGYKAPETAWKSVSYIYDILGRLI
CCCCCCCHHHHHCCEEEECCCCEEEEECCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHH
TQINADATTVSYDRATVSLQVLVTNERGYKHRYYYDSYLRLTKVVEYDANNAIYATTEYT
HHCCCCCEEEEECCEEEEEEEEEECCCCCEEEEEEHHHHEEEHEEEECCCCEEEEEECCC
YDTLGNLTQVKDNSNNITSISYDWLNRKTGMMDPDMGSWVYGYDNNGNIISQTDALSHTI
HHHHCCEEEECCCCCCEEEEEEHHHCCCCCCCCCCCCCEEEEECCCCCEEECCHHHHHHH
SYAYDALNRLTSKTYPAGLGMTDVSYNYDSTANGNYGLGLRTSMTDAVGTIVWTYDSWGR
HHHHHHHHHHHCCCCCCCCCCEEEECCCCCCCCCCCCCEECCCCCCCCEEEEEEECCCCC
NIEELRTIDSVDYATSYIYDGLNRITTITYPTGEVVTNTYNGRGLPYALSGSTTGNLVTS
CHHHHHHHCCHHHHHHHHHHCCCCEEEEEECCCCEEEECCCCCCCCEEECCCCCCHHHHH
TLYNQLAQPKEINFGNTLRTTFGYYGLGGSYDTTGGYYGNLWEIKTLPQSGGNVLQDTRY
HHHHHHCCCCCCCCCCCHHHHCCEECCCCCCCCCCCCCCCEEEEEECCCCCCCCCCCCCE
TWDAGDNVSTRQDVLSSQTETFTYDFLGRLTAVSGAYIASYSYNQIGNIVAMNGSSYTYS
EECCCCCCCHHHHHHCCCCCEEEHHHHHHHHHHCCEEEEEECHHHCCCEEEECCCCEEEC
TQPHAVTQVGTTNYLYDANGNMTNRGTQTLTWDLENRPVSITEGGDITTFIYDGDGNRIK
CCCCEEEEECCCEEEECCCCCCCCCCCEEEEEEECCCCEEEECCCCEEEEEEECCCCCEE
QITSIETILYINKFYEKNLATDEVTTRYYFGDTMMAERQGTTLRYVHQDSINSTSLVTSN
HHHHHHHHHHHHHHHHCCCCCCCEEEEEEECCCEEECCCCCEEEEEECCCCCCCEEEECC
TGTALGSTKYYPYGVTRSGSVPVDEQFTGQKLDGTGLYYYNARYYDPTLGRFLSADIYIQ
CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCEECCCEEEEEEEEEECCHHHHHEECEEEEE
DFTNPQCLNRYSYCQNNPLKYTDPSGHFAWFLPIIGAAIGAVAGAVKTVVDCAIHPEKAF
ECCCHHHHHHHHHHCCCCCEECCCCCCEEEHHHHHHHHHHHHHHHHHHHHHHHCCCHHHC
STKELIANVVGGAVAGALAFTGIGILADITAEVSTAFVVVANLAVSEVSNVVDSVIESAM
CHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHEEHHHHHHHHHHHHHHHHHHHHHHH
TGEDYTINDLTTDVISGALTGPAGVGIAPSLNKIITNKEVVAGVITSGFQIFTNTIRSIF
CCCCEEEHHHHHHHHHCCCCCCCCCCCCCCHHHHHCCHHHHHHHHHCCHHHHHHHHHHHH
GLTNNVNSGKSKRNSDINSGLVFYGTSRPSVQLL
CCCCCCCCCCCCCCCCCCCCEEEEECCCCCEEEC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 8316082; 7704263; 8969509; 9384377; 10658653 [H]