Definition Frankia sp. EAN1pec chromosome, complete genome.
Accession NC_009921
Length 8,982,042

Click here to switch to the map view.

The map label for this gene is 158318813

Identifier: 158318813

GI number: 158318813

Start: 8648994

End: 8652791

Strand: Direct

Name: 158318813

Synonym: Franean1_7085

Alternate gene names: NA

Gene position: 8648994-8652791 (Clockwise)

Preceding gene: 158318812

Following gene: 158318814

Centisome position: 96.29

GC content: 69.98

Gene sequence:

>3798_bases
GTGCCGGCCCCGGGCGCCCTTGATGATCCGACTGGGACGGTCGTCTGCCCGTATCCGGGGCTTGCCGGATTCGATGCTGC
GAGTGAGCGGTGGTTCTTCGGTCGGGAGCGGATGGTTACTGACCTGGTCGTGCGGGTGGGGGTGCGGCTGAGTGAGGGTG
GTCCGCTGGTCTTGGTGGGGGCGTCCGGGTCGGGTAAGTCGTCGTTGTTGCGTGCGGGCCTGTTGCCGGTTCTGGCACGT
GGGGTGGTCGCAGGGTCGGACTCTTGGCCGCAGGTGTTGATGACGCCGGGTGAACATCCCTTGCGGAGTCTGATCGATCA
GATCGCGGCTGCCGGAATCCCTGCGGCGGCGTTGCTCAACGACGGTACGGCTGTGGTCCCGGAGGTCCCGGACCGGCTCG
CCGAGCTCTTGGCGTCCCACGCGGGCGGCAGTGGCCTGGTGATCGCGGTGGACCAGTTCGAGGAGGTCTTCACCTTGTGT
GACGATCTTTCGGAGCGGGAGGCATTCATTCGGGCACTGTGCGTGGCAGCGGCCTGTCGGGGTGATCGGGGGCCGGCTGC
TGTGGTCGTCCTTGGTCTGCGGGCCGATTTTTACGCCCGGTGCGCTGCCTATCCGGAGTTGGTCGAGGCGCTGCAGACTG
GCCAGGTGGTGGTCGGTCCGATGACGGCCGCGGAGATCCGTGACGTCGTGGTCAAGCCGGCGAGCACGGCTGGTGTTGAT
GTGGAGCCGGGTCTGGTCGAGCTGCTGTTGCGTGATCTGGGGGCGGCGACGGCGGCGTCGCCGGACGGCGCGTTGAGTGG
TGCGGGTGTGGTCACCGATCCCGGTTCGCTGCCGTTGCTTGCGCATGCCTTGCGTTCGGCGTGGTTCGCTCGGGACGCAT
CGGGGTTGACGGTGGGGGCGTATCTGCGGATCGGCGGGTTGACCGGCGCGATCGCGCAGACGGCTGAGCGCGCCTATACG
GGGTTGGACGCCGCGGCGCAGCAGGCCGCACGGCCGTTGTTGATGCGGATGGTCCGCCTCGGCGAGGGGGAACAGGACAG
TAGGCGGCGGGTCCGGCGGGCGGACCTACTCGCCGCGGTGCCCGTCCGCGAGGCGGCCGCCGTGCTGGACGCGCTGATCG
CGGCTTTCCTCGTGGAGGCGGACGCCGATGGCGACAGCGACAGCCTGCAGATCGCGCACGAGGCGCTGTTGTGGTCGTGG
CCGCGGTTGCGGGAGTGGATGGACCTCGACCGGGCAAGCGCGGTCGCGCTGCAGCAGCTCAACGACGCGGCCGAGATCTG
GGAAGCGGGGGGCCGCGATCCCTCCTACCTGTTCGGCGGGACACGGTTGGCGGCGGCCCGTGAATGGGTGGAAGCCCACC
CGGGCCGTGCGCCTATGTCCCCGGTCGCTCGGGATTTCTACGACGAGAGCCTGCGGGCTGACAGCGCCGCCCAGCGGGCG
GTGGTGCGGCGGACCCGGCGTCTGCGCCGGCTCGTCGCCGCGTTGACGGTCCTGGTGGTGGCGGCAGCGTCGCTGGCCGG
GCTGGTCTACCGGCAGAAGACCACGGCGGCGGACGCGCGGGACCGGGCGCTGTCCCAGCGGATCGCGAGCCAGGCCGATA
TCGCCCGTGATCGGAACCCGGCGATCGCGGCACAACTCAGCCTGGTCGCCTACCGCACGGCGAACACACCGGAGGCACGG
GGCAGTGTGCTGTCGTCGTTCAACGGTGGTTCCGGGGTGCCAACGCGGTATCTGTTTCACCGCAACGCCGTCGGCACGGT
GACCTACAGCCCGAACGGGAAGCTGATCGCGACGGGCAGCGACGACTGGACCGCGGCGATCTGGGACGCAGCCGACCCCC
GCCGGTCGACCCCGCTCGCGGTCCTGCCGGGCCCGCAGGACGGGGGTCATAGCCGGGCGGTGAAGTCGGTGGCGTTCAGC
CGGGACTCGAGGCTGCTCGCCACTGGTAGCGGCGACCGGACGGCCAAGATCTGGGACGTCTCGACGCCGAGCCGGCCCCG
GCTGCTGGCGACTCTGCCGGAGACGACCGGGGACGTCTACGGGCTGGCGTTCAGCCCGGTCGCGGACCGGCTCGCCGTCG
CCGGGTACGGCAACTCCGCGCGGATCTACGATGTGTCCGAGCCGGGCCGGCCGGCCGTGCAGGGTGCGCTCCTGATCAAC
GGTGAGACGCCCTTGCACCAGGGACCGATCGACACACTCGCTTTCAGCCCGGACGGTTACATTCTCGCCGCCGGTGACGA
GGCCGCATCCACGGTGCTCTGGTATGTCGGACCAGCCCTGGACATCATGCCGGTCGACCTGCTCAACGTGCCCGACGACG
ATCCGACCGCGGACCGGGTCGGCACGATCCGGGCTGTAGCGTTCGGTCCCGATGGCAGAAGCGTCTACACCGCGGGGGTC
GCAGGCCGGATCCGGGTATTCAGCGGACCGGATCTGCTCCACCTGACCCATACCGCGACCATGGGTGTTGGGAACGGGCC
GATGGCCGCGCTCGCGGTCGCGCCGACCGGTGGGCTGGTCGCCGTGGGTGGAAACCTGTTCAGCGGTGTTCCGCTGTTCG
ATCCCGCCGCCGCCACACAGCAAGCCGTCCTCAGCGATCCCTCCGACGGGGCGAGAGCGCTTACTTTCCTCAATGAGGGC
ACGGTGACCTGGACGGTCGCGTTCAGCCCCGACGGGCGCCACCTCGCCAGCGGATCCGCGGATGGCGCACTGCGGGTCTG
GGAGATCCCAGGGCCGGCGCTGATCGGCCGTCACGGCGACCAGAAGTCGGCCGAGGTCAACCCGCGCACCGGCGACGTCG
TCACAGTGACCGACTCGGCGGCGGAACTCTGGAACATCACCGACCCGTACCGTCCCACCTCGCTGTCGGTCATCACCGAC
GCCCTGGCCGACGAGTACGACCTCACGACTAGTGCGGCGTTCCATCCCGACGGCCGCATCCTGGCTGTCGGGACGGCGAA
GCGGGTTTGTCTCTACGACATCACGGATCCGAGGCGACCATTCATGATCACTGCGTTTGAAGGGCCGGCCGGCGGGGTGT
TCTCCCTGCGTTTCAGCCCGGACGGCCGGACTCTCGTCCTCGGTGGTCTCGGCTCGTCACCAGCGCCTGCCTTTTCCGCC
AGTCTGGAGACCTGGGACGTGCGTGACCCGCGGCATCCGGCCAGGCTTGCCAGCACGGTCGCGCACCGCGGCAGCGTGCG
GGACATCCAGTTCAGCGAGGACGGACACGTCATGGCGTCCGTAGCCGATCGCACCGTGCAGCTGTGGGACGTCAGCGATC
CGCGCCGGATCGCCGCCCGGGCGACCCTGCCGGACTTCCCCGGCGCGGCGCTGCGCGCTGCGTTCGCCCCGGACGGCCGG
ACCCTCGCGGTCGGCGGCGGAGGACCCTACGCGACCCTGTGGAACATCACCGACCCGGCGCGGCCGACCCGGACCGCATC
GCTGCCCGGCCACGTCAGCGAGGTCAACACCGTGACGTTTAGCCCCGACGGTCGCACGCTCGTGACCGGCAGCGGGGACA
ACTCGGTGCGGGTCTGGGACGTCCGCCGTCCCTCGAATCCGAGGTTGGTCGAACGGTTGAGCCGTTCCGCCGGCACCAAC
AGCGGGATCGGCACGGTTGCCTTCTCCCGGGACGGATCCACCCTGGTCGGTGTCGTCTTCACCGAACCAGGAGCACTGTG
GGACCTGGACGTGGACCGGGTCGCGCAACGCATCTGCGCGCAGGCCGGGGTCGGCATCACCAGGGATGAATGGGCGCGTT
TCCTTCCGGACAGGGCCTACGATCCGCCGTGTGACTGA

Upstream 100 bases:

>100_bases
TCCCACCCGTATCCTCGGCGTTCCCTCGGACCAGCCGCCGCTAGCTGGGGAGGCTGCGCCTGCTCTGCCGGTTCAGCCTG
TTCCGGGGTCCTCGGCTCTG

Downstream 100 bases:

>100_bases
ACCAGGGGCCGCGGCGCTTCCCCTGCCCGTGTCGTCCCCGGTACCGGGGTACCGGGGACGACACGGGCAGCGGCCAGGTG
GGTGGCGCTGTCGGAGCACC

Product: WD-40 repeat-containing protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 1265; Mature: 1264

Protein sequence:

>1265_residues
MPAPGALDDPTGTVVCPYPGLAGFDAASERWFFGRERMVTDLVVRVGVRLSEGGPLVLVGASGSGKSSLLRAGLLPVLAR
GVVAGSDSWPQVLMTPGEHPLRSLIDQIAAAGIPAAALLNDGTAVVPEVPDRLAELLASHAGGSGLVIAVDQFEEVFTLC
DDLSEREAFIRALCVAAACRGDRGPAAVVVLGLRADFYARCAAYPELVEALQTGQVVVGPMTAAEIRDVVVKPASTAGVD
VEPGLVELLLRDLGAATAASPDGALSGAGVVTDPGSLPLLAHALRSAWFARDASGLTVGAYLRIGGLTGAIAQTAERAYT
GLDAAAQQAARPLLMRMVRLGEGEQDSRRRVRRADLLAAVPVREAAAVLDALIAAFLVEADADGDSDSLQIAHEALLWSW
PRLREWMDLDRASAVALQQLNDAAEIWEAGGRDPSYLFGGTRLAAAREWVEAHPGRAPMSPVARDFYDESLRADSAAQRA
VVRRTRRLRRLVAALTVLVVAAASLAGLVYRQKTTAADARDRALSQRIASQADIARDRNPAIAAQLSLVAYRTANTPEAR
GSVLSSFNGGSGVPTRYLFHRNAVGTVTYSPNGKLIATGSDDWTAAIWDAADPRRSTPLAVLPGPQDGGHSRAVKSVAFS
RDSRLLATGSGDRTAKIWDVSTPSRPRLLATLPETTGDVYGLAFSPVADRLAVAGYGNSARIYDVSEPGRPAVQGALLIN
GETPLHQGPIDTLAFSPDGYILAAGDEAASTVLWYVGPALDIMPVDLLNVPDDDPTADRVGTIRAVAFGPDGRSVYTAGV
AGRIRVFSGPDLLHLTHTATMGVGNGPMAALAVAPTGGLVAVGGNLFSGVPLFDPAAATQQAVLSDPSDGARALTFLNEG
TVTWTVAFSPDGRHLASGSADGALRVWEIPGPALIGRHGDQKSAEVNPRTGDVVTVTDSAAELWNITDPYRPTSLSVITD
ALADEYDLTTSAAFHPDGRILAVGTAKRVCLYDITDPRRPFMITAFEGPAGGVFSLRFSPDGRTLVLGGLGSSPAPAFSA
SLETWDVRDPRHPARLASTVAHRGSVRDIQFSEDGHVMASVADRTVQLWDVSDPRRIAARATLPDFPGAALRAAFAPDGR
TLAVGGGGPYATLWNITDPARPTRTASLPGHVSEVNTVTFSPDGRTLVTGSGDNSVRVWDVRRPSNPRLVERLSRSAGTN
SGIGTVAFSRDGSTLVGVVFTEPGALWDLDVDRVAQRICAQAGVGITRDEWARFLPDRAYDPPCD

Sequences:

>Translated_1265_residues
MPAPGALDDPTGTVVCPYPGLAGFDAASERWFFGRERMVTDLVVRVGVRLSEGGPLVLVGASGSGKSSLLRAGLLPVLAR
GVVAGSDSWPQVLMTPGEHPLRSLIDQIAAAGIPAAALLNDGTAVVPEVPDRLAELLASHAGGSGLVIAVDQFEEVFTLC
DDLSEREAFIRALCVAAACRGDRGPAAVVVLGLRADFYARCAAYPELVEALQTGQVVVGPMTAAEIRDVVVKPASTAGVD
VEPGLVELLLRDLGAATAASPDGALSGAGVVTDPGSLPLLAHALRSAWFARDASGLTVGAYLRIGGLTGAIAQTAERAYT
GLDAAAQQAARPLLMRMVRLGEGEQDSRRRVRRADLLAAVPVREAAAVLDALIAAFLVEADADGDSDSLQIAHEALLWSW
PRLREWMDLDRASAVALQQLNDAAEIWEAGGRDPSYLFGGTRLAAAREWVEAHPGRAPMSPVARDFYDESLRADSAAQRA
VVRRTRRLRRLVAALTVLVVAAASLAGLVYRQKTTAADARDRALSQRIASQADIARDRNPAIAAQLSLVAYRTANTPEAR
GSVLSSFNGGSGVPTRYLFHRNAVGTVTYSPNGKLIATGSDDWTAAIWDAADPRRSTPLAVLPGPQDGGHSRAVKSVAFS
RDSRLLATGSGDRTAKIWDVSTPSRPRLLATLPETTGDVYGLAFSPVADRLAVAGYGNSARIYDVSEPGRPAVQGALLIN
GETPLHQGPIDTLAFSPDGYILAAGDEAASTVLWYVGPALDIMPVDLLNVPDDDPTADRVGTIRAVAFGPDGRSVYTAGV
AGRIRVFSGPDLLHLTHTATMGVGNGPMAALAVAPTGGLVAVGGNLFSGVPLFDPAAATQQAVLSDPSDGARALTFLNEG
TVTWTVAFSPDGRHLASGSADGALRVWEIPGPALIGRHGDQKSAEVNPRTGDVVTVTDSAAELWNITDPYRPTSLSVITD
ALADEYDLTTSAAFHPDGRILAVGTAKRVCLYDITDPRRPFMITAFEGPAGGVFSLRFSPDGRTLVLGGLGSSPAPAFSA
SLETWDVRDPRHPARLASTVAHRGSVRDIQFSEDGHVMASVADRTVQLWDVSDPRRIAARATLPDFPGAALRAAFAPDGR
TLAVGGGGPYATLWNITDPARPTRTASLPGHVSEVNTVTFSPDGRTLVTGSGDNSVRVWDVRRPSNPRLVERLSRSAGTN
SGIGTVAFSRDGSTLVGVVFTEPGALWDLDVDRVAQRICAQAGVGITRDEWARFLPDRAYDPPCD
>Mature_1264_residues
PAPGALDDPTGTVVCPYPGLAGFDAASERWFFGRERMVTDLVVRVGVRLSEGGPLVLVGASGSGKSSLLRAGLLPVLARG
VVAGSDSWPQVLMTPGEHPLRSLIDQIAAAGIPAAALLNDGTAVVPEVPDRLAELLASHAGGSGLVIAVDQFEEVFTLCD
DLSEREAFIRALCVAAACRGDRGPAAVVVLGLRADFYARCAAYPELVEALQTGQVVVGPMTAAEIRDVVVKPASTAGVDV
EPGLVELLLRDLGAATAASPDGALSGAGVVTDPGSLPLLAHALRSAWFARDASGLTVGAYLRIGGLTGAIAQTAERAYTG
LDAAAQQAARPLLMRMVRLGEGEQDSRRRVRRADLLAAVPVREAAAVLDALIAAFLVEADADGDSDSLQIAHEALLWSWP
RLREWMDLDRASAVALQQLNDAAEIWEAGGRDPSYLFGGTRLAAAREWVEAHPGRAPMSPVARDFYDESLRADSAAQRAV
VRRTRRLRRLVAALTVLVVAAASLAGLVYRQKTTAADARDRALSQRIASQADIARDRNPAIAAQLSLVAYRTANTPEARG
SVLSSFNGGSGVPTRYLFHRNAVGTVTYSPNGKLIATGSDDWTAAIWDAADPRRSTPLAVLPGPQDGGHSRAVKSVAFSR
DSRLLATGSGDRTAKIWDVSTPSRPRLLATLPETTGDVYGLAFSPVADRLAVAGYGNSARIYDVSEPGRPAVQGALLING
ETPLHQGPIDTLAFSPDGYILAAGDEAASTVLWYVGPALDIMPVDLLNVPDDDPTADRVGTIRAVAFGPDGRSVYTAGVA
GRIRVFSGPDLLHLTHTATMGVGNGPMAALAVAPTGGLVAVGGNLFSGVPLFDPAAATQQAVLSDPSDGARALTFLNEGT
VTWTVAFSPDGRHLASGSADGALRVWEIPGPALIGRHGDQKSAEVNPRTGDVVTVTDSAAELWNITDPYRPTSLSVITDA
LADEYDLTTSAAFHPDGRILAVGTAKRVCLYDITDPRRPFMITAFEGPAGGVFSLRFSPDGRTLVLGGLGSSPAPAFSAS
LETWDVRDPRHPARLASTVAHRGSVRDIQFSEDGHVMASVADRTVQLWDVSDPRRIAARATLPDFPGAALRAAFAPDGRT
LAVGGGGPYATLWNITDPARPTRTASLPGHVSEVNTVTFSPDGRTLVTGSGDNSVRVWDVRRPSNPRLVERLSRSAGTNS
GIGTVAFSRDGSTLVGVVFTEPGALWDLDVDRVAQRICAQAGVGITRDEWARFLPDRAYDPPCD

Specific function: Unknown

COG id: COG2319

COG function: function code R; FOG: WD40 repeat

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Contains 13 WD repeats [H]

Homologues:

Organism=Homo sapiens, GI16554629, Length=230, Percent_Identity=27.3913043478261, Blast_Score=87, Evalue=7e-17,
Organism=Homo sapiens, GI16554627, Length=230, Percent_Identity=27.3913043478261, Blast_Score=87, Evalue=7e-17,
Organism=Homo sapiens, GI26665869, Length=248, Percent_Identity=27.8225806451613, Blast_Score=84, Evalue=6e-16,
Organism=Homo sapiens, GI113865883, Length=228, Percent_Identity=29.3859649122807, Blast_Score=83, Evalue=1e-15,
Organism=Homo sapiens, GI21536371, Length=610, Percent_Identity=24.4262295081967, Blast_Score=83, Evalue=2e-15,
Organism=Homo sapiens, GI11055998, Length=216, Percent_Identity=27.3148148148148, Blast_Score=81, Evalue=8e-15,
Organism=Homo sapiens, GI20357529, Length=217, Percent_Identity=28.110599078341, Blast_Score=80, Evalue=1e-14,
Organism=Homo sapiens, GI21071067, Length=311, Percent_Identity=27.0096463022508, Blast_Score=77, Evalue=8e-14,
Organism=Homo sapiens, GI23199987, Length=269, Percent_Identity=24.5353159851301, Blast_Score=77, Evalue=1e-13,
Organism=Homo sapiens, GI239787754, Length=185, Percent_Identity=32.4324324324324, Blast_Score=77, Evalue=1e-13,
Organism=Homo sapiens, GI239787764, Length=185, Percent_Identity=32.4324324324324, Blast_Score=77, Evalue=1e-13,
Organism=Homo sapiens, GI83779014, Length=218, Percent_Identity=27.5229357798165, Blast_Score=77, Evalue=1e-13,
Organism=Homo sapiens, GI115298668, Length=379, Percent_Identity=23.4828496042216, Blast_Score=74, Evalue=9e-13,
Organism=Homo sapiens, GI11321585, Length=225, Percent_Identity=27.1111111111111, Blast_Score=74, Evalue=1e-12,
Organism=Homo sapiens, GI70909324, Length=210, Percent_Identity=27.1428571428571, Blast_Score=73, Evalue=2e-12,
Organism=Homo sapiens, GI239787760, Length=185, Percent_Identity=32.4324324324324, Blast_Score=73, Evalue=2e-12,
Organism=Homo sapiens, GI32189425, Length=344, Percent_Identity=21.5116279069767, Blast_Score=73, Evalue=2e-12,
Organism=Homo sapiens, GI62234461, Length=129, Percent_Identity=35.6589147286822, Blast_Score=72, Evalue=4e-12,
Organism=Homo sapiens, GI62234438, Length=129, Percent_Identity=35.6589147286822, Blast_Score=72, Evalue=4e-12,
Organism=Homo sapiens, GI4757988, Length=177, Percent_Identity=29.9435028248588, Blast_Score=71, Evalue=6e-12,
Organism=Homo sapiens, GI24431950, Length=311, Percent_Identity=25.7234726688103, Blast_Score=71, Evalue=6e-12,
Organism=Homo sapiens, GI18677720, Length=207, Percent_Identity=28.0193236714976, Blast_Score=70, Evalue=1e-11,
Organism=Homo sapiens, GI7657439, Length=166, Percent_Identity=30.1204819277108, Blast_Score=70, Evalue=1e-11,
Organism=Homo sapiens, GI20143912, Length=193, Percent_Identity=28.4974093264249, Blast_Score=70, Evalue=2e-11,
Organism=Caenorhabditis elegans, GI17534675, Length=218, Percent_Identity=27.5229357798165, Blast_Score=81, Evalue=5e-15,
Organism=Caenorhabditis elegans, GI71990665, Length=211, Percent_Identity=25.1184834123223, Blast_Score=74, Evalue=5e-13,
Organism=Caenorhabditis elegans, GI17552164, Length=228, Percent_Identity=24.1228070175439, Blast_Score=72, Evalue=2e-12,
Organism=Caenorhabditis elegans, GI115533709, Length=184, Percent_Identity=30.9782608695652, Blast_Score=67, Evalue=7e-11,
Organism=Saccharomyces cerevisiae, GI6319675, Length=227, Percent_Identity=29.5154185022026, Blast_Score=71, Evalue=1e-12,
Organism=Saccharomyces cerevisiae, GI6324322, Length=265, Percent_Identity=24.1509433962264, Blast_Score=70, Evalue=2e-12,
Organism=Drosophila melanogaster, GI17864654, Length=230, Percent_Identity=27.3913043478261, Blast_Score=87, Evalue=9e-17,
Organism=Drosophila melanogaster, GI24666913, Length=302, Percent_Identity=22.8476821192053, Blast_Score=78, Evalue=4e-14,
Organism=Drosophila melanogaster, GI45555412, Length=218, Percent_Identity=25.6880733944954, Blast_Score=77, Evalue=1e-13,
Organism=Drosophila melanogaster, GI45555420, Length=218, Percent_Identity=25.6880733944954, Blast_Score=77, Evalue=1e-13,
Organism=Drosophila melanogaster, GI45555433, Length=218, Percent_Identity=25.6880733944954, Blast_Score=77, Evalue=1e-13,
Organism=Drosophila melanogaster, GI45555444, Length=218, Percent_Identity=25.6880733944954, Blast_Score=77, Evalue=1e-13,
Organism=Drosophila melanogaster, GI17933598, Length=218, Percent_Identity=25.6880733944954, Blast_Score=77, Evalue=1e-13,
Organism=Drosophila melanogaster, GI24642327, Length=218, Percent_Identity=25.6880733944954, Blast_Score=77, Evalue=1e-13,
Organism=Drosophila melanogaster, GI45549090, Length=136, Percent_Identity=33.8235294117647, Blast_Score=75, Evalue=2e-13,
Organism=Drosophila melanogaster, GI24663767, Length=231, Percent_Identity=28.5714285714286, Blast_Score=75, Evalue=3e-13,
Organism=Drosophila melanogaster, GI17136870, Length=383, Percent_Identity=24.0208877284595, Blast_Score=73, Evalue=2e-12,
Organism=Drosophila melanogaster, GI20129125, Length=220, Percent_Identity=26.8181818181818, Blast_Score=73, Evalue=2e-12,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR020472
- InterPro:   IPR011600
- InterPro:   IPR015943
- InterPro:   IPR001680
- InterPro:   IPR011046
- InterPro:   IPR019782
- InterPro:   IPR019775
- InterPro:   IPR017986
- InterPro:   IPR019781 [H]

Pfam domain/function: PF00656 Peptidase_C14; PF00400 WD40 [H]

EC number: NA

Molecular weight: Translated: 132660; Mature: 132529

Theoretical pI: Translated: 5.26; Mature: 5.26

Prosite motif: PS00678 WD_REPEATS_1 ; PS50082 WD_REPEATS_2 ; PS50294 WD_REPEATS_REGION

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.6 %Cys     (Translated Protein)
1.0 %Met     (Translated Protein)
1.7 %Cys+Met (Translated Protein)
0.6 %Cys     (Mature Protein)
0.9 %Met     (Mature Protein)
1.6 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MPAPGALDDPTGTVVCPYPGLAGFDAASERWFFGRERMVTDLVVRVGVRLSEGGPLVLVG
CCCCCCCCCCCCEEEECCCCCCCCCCCCCCEECCHHHHHHHHHHHHCCEECCCCCEEEEE
ASGSGKSSLLRAGLLPVLARGVVAGSDSWPQVLMTPGEHPLRSLIDQIAAAGIPAAALLN
CCCCCHHHHHHHHHHHHHHHHEEECCCCCCEEEECCCCCHHHHHHHHHHHCCCCHHHHCC
DGTAVVPEVPDRLAELLASHAGGSGLVIAVDQFEEVFTLCDDLSEREAFIRALCVAAACR
CCCEECCCCHHHHHHHHHHCCCCCEEEEEHHHHHHHHHHHHCHHHHHHHHHHHHHHHHHC
GDRGPAAVVVLGLRADFYARCAAYPELVEALQTGQVVVGPMTAAEIRDVVVKPASTAGVD
CCCCCEEEEEEECCHHHHHHHHCCHHHHHHHHCCCEEEECCCHHHHHHHHCCCCCCCCCC
VEPGLVELLLRDLGAATAASPDGALSGAGVVTDPGSLPLLAHALRSAWFARDASGLTVGA
CCCHHHHHHHHHHCCCCCCCCCCCCCCCCEEECCCCCHHHHHHHHHHHHHCCCCCCEEEE
YLRIGGLTGAIAQTAERAYTGLDAAAQQAARPLLMRMVRLGEGEQDSRRRVRRADLLAAV
EEEECCCHHHHHHHHHHHHHCHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHCC
PVREAAAVLDALIAAFLVEADADGDSDSLQIAHEALLWSWPRLREWMDLDRASAVALQQL
CHHHHHHHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHCCCHHHHHHHCCHHHHHHHHHHH
NDAAEIWEAGGRDPSYLFGGTRLAAAREWVEAHPGRAPMSPVARDFYDESLRADSAAQRA
HHHHHHHHCCCCCCCEEECCHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHCCCHHHHHH
VVRRTRRLRRLVAALTVLVVAAASLAGLVYRQKTTAADARDRALSQRIASQADIARDRNP
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHCCCCC
AIAAQLSLVAYRTANTPEARGSVLSSFNGGSGVPTRYLFHRNAVGTVTYSPNGKLIATGS
CCEEEEEEEEEECCCCCHHHHHHHHCCCCCCCCCEEEEEECCCEEEEEECCCCCEEEECC
DDWTAAIWDAADPRRSTPLAVLPGPQDGGHSRAVKSVAFSRDSRLLATGSGDRTAKIWDV
CCCEEEEECCCCCCCCCCEEEECCCCCCCHHHHHHHHHHCCCCEEEEECCCCCEEEEEEC
STPSRPRLLATLPETTGDVYGLAFSPVADRLAVAGYGNSARIYDVSEPGRPAVQGALLIN
CCCCCCEEEEECCCCCCCEEEEEECCHHHHEEEEECCCCCEEEECCCCCCCCEEEEEEEC
GETPLHQGPIDTLAFSPDGYILAAGDEAASTVLWYVGPALDIMPVDLLNVPDDDPTADRV
CCCCCCCCCCCCEEECCCCEEEEECCCHHCEEEEEECCCCCEEEEEEECCCCCCCCCHHC
GTIRAVAFGPDGRSVYTAGVAGRIRVFSGPDLLHLTHTATMGVGNGPMAALAVAPTGGLV
CEEEEEEECCCCCEEEEECCCCEEEEECCCCEEEEEEEEEECCCCCCEEEEEEECCCCEE
AVGGNLFSGVPLFDPAAATQQAVLSDPSDGARALTFLNEGTVTWTVAFSPDGRHLASGSA
EECCCHHCCCCCCCCHHHHHHHHHCCCCCCCEEEEEEECCEEEEEEEECCCCCEECCCCC
DGALRVWEIPGPALIGRHGDQKSAEVNPRTGDVVTVTDSAAELWNITDPYRPTSLSVITD
CCCEEEEECCCCCEECCCCCCCCCCCCCCCCCEEEEECCCHHHCCCCCCCCCCHHHHHHH
ALADEYDLTTSAAFHPDGRILAVGTAKRVCLYDITDPRRPFMITAFEGPAGGVFSLRFSP
HHHCCCCCCCCEEECCCCCEEEEECCCEEEEEECCCCCCCEEEEEEECCCCCEEEEEECC
DGRTLVLGGLGSSPAPAFSASLETWDVRDPRHPARLASTVAHRGSVRDIQFSEDGHVMAS
CCCEEEEECCCCCCCCCCCCCCCEECCCCCCCHHHHHHHHHHCCCCEEEEECCCCCEEEE
VADRTVQLWDVSDPRRIAARATLPDFPGAALRAAFAPDGRTLAVGGGGPYATLWNITDPA
ECCCEEEEEECCCCHHHEEECCCCCCCCHHHEEEECCCCCEEEEECCCCEEEEEECCCCC
RPTRTASLPGHVSEVNTVTFSPDGRTLVTGSGDNSVRVWDVRRPSNPRLVERLSRSAGTN
CCCCCCCCCCCCCCCEEEEECCCCCEEEECCCCCCEEEEEECCCCCHHHHHHHHHHCCCC
SGIGTVAFSRDGSTLVGVVFTEPGALWDLDVDRVAQRICAQAGVGITRDEWARFLPDRAY
CCCEEEEEECCCCEEEEEEEECCCCEEECCHHHHHHHHHHHCCCCCCHHHHHHHCCCCCC
DPPCD
CCCCC
>Mature Secondary Structure 
PAPGALDDPTGTVVCPYPGLAGFDAASERWFFGRERMVTDLVVRVGVRLSEGGPLVLVG
CCCCCCCCCCCEEEECCCCCCCCCCCCCCEECCHHHHHHHHHHHHCCEECCCCCEEEEE
ASGSGKSSLLRAGLLPVLARGVVAGSDSWPQVLMTPGEHPLRSLIDQIAAAGIPAAALLN
CCCCCHHHHHHHHHHHHHHHHEEECCCCCCEEEECCCCCHHHHHHHHHHHCCCCHHHHCC
DGTAVVPEVPDRLAELLASHAGGSGLVIAVDQFEEVFTLCDDLSEREAFIRALCVAAACR
CCCEECCCCHHHHHHHHHHCCCCCEEEEEHHHHHHHHHHHHCHHHHHHHHHHHHHHHHHC
GDRGPAAVVVLGLRADFYARCAAYPELVEALQTGQVVVGPMTAAEIRDVVVKPASTAGVD
CCCCCEEEEEEECCHHHHHHHHCCHHHHHHHHCCCEEEECCCHHHHHHHHCCCCCCCCCC
VEPGLVELLLRDLGAATAASPDGALSGAGVVTDPGSLPLLAHALRSAWFARDASGLTVGA
CCCHHHHHHHHHHCCCCCCCCCCCCCCCCEEECCCCCHHHHHHHHHHHHHCCCCCCEEEE
YLRIGGLTGAIAQTAERAYTGLDAAAQQAARPLLMRMVRLGEGEQDSRRRVRRADLLAAV
EEEECCCHHHHHHHHHHHHHCHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHCC
PVREAAAVLDALIAAFLVEADADGDSDSLQIAHEALLWSWPRLREWMDLDRASAVALQQL
CHHHHHHHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHCCCHHHHHHHCCHHHHHHHHHHH
NDAAEIWEAGGRDPSYLFGGTRLAAAREWVEAHPGRAPMSPVARDFYDESLRADSAAQRA
HHHHHHHHCCCCCCCEEECCHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHCCCHHHHHH
VVRRTRRLRRLVAALTVLVVAAASLAGLVYRQKTTAADARDRALSQRIASQADIARDRNP
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHCCCCC
AIAAQLSLVAYRTANTPEARGSVLSSFNGGSGVPTRYLFHRNAVGTVTYSPNGKLIATGS
CCEEEEEEEEEECCCCCHHHHHHHHCCCCCCCCCEEEEEECCCEEEEEECCCCCEEEECC
DDWTAAIWDAADPRRSTPLAVLPGPQDGGHSRAVKSVAFSRDSRLLATGSGDRTAKIWDV
CCCEEEEECCCCCCCCCCEEEECCCCCCCHHHHHHHHHHCCCCEEEEECCCCCEEEEEEC
STPSRPRLLATLPETTGDVYGLAFSPVADRLAVAGYGNSARIYDVSEPGRPAVQGALLIN
CCCCCCEEEEECCCCCCCEEEEEECCHHHHEEEEECCCCCEEEECCCCCCCCEEEEEEEC
GETPLHQGPIDTLAFSPDGYILAAGDEAASTVLWYVGPALDIMPVDLLNVPDDDPTADRV
CCCCCCCCCCCCEEECCCCEEEEECCCHHCEEEEEECCCCCEEEEEEECCCCCCCCCHHC
GTIRAVAFGPDGRSVYTAGVAGRIRVFSGPDLLHLTHTATMGVGNGPMAALAVAPTGGLV
CEEEEEEECCCCCEEEEECCCCEEEEECCCCEEEEEEEEEECCCCCCEEEEEEECCCCEE
AVGGNLFSGVPLFDPAAATQQAVLSDPSDGARALTFLNEGTVTWTVAFSPDGRHLASGSA
EECCCHHCCCCCCCCHHHHHHHHHCCCCCCCEEEEEEECCEEEEEEEECCCCCEECCCCC
DGALRVWEIPGPALIGRHGDQKSAEVNPRTGDVVTVTDSAAELWNITDPYRPTSLSVITD
CCCEEEEECCCCCEECCCCCCCCCCCCCCCCCEEEEECCCHHHCCCCCCCCCCHHHHHHH
ALADEYDLTTSAAFHPDGRILAVGTAKRVCLYDITDPRRPFMITAFEGPAGGVFSLRFSP
HHHCCCCCCCCEEECCCCCEEEEECCCEEEEEECCCCCCCEEEEEEECCCCCEEEEEECC
DGRTLVLGGLGSSPAPAFSASLETWDVRDPRHPARLASTVAHRGSVRDIQFSEDGHVMAS
CCCEEEEECCCCCCCCCCCCCCCEECCCCCCCHHHHHHHHHHCCCCEEEEECCCCCEEEE
VADRTVQLWDVSDPRRIAARATLPDFPGAALRAAFAPDGRTLAVGGGGPYATLWNITDPA
ECCCEEEEEECCCCHHHEEECCCCCCCCHHHEEEECCCCCEEEEECCCCEEEEEECCCCC
RPTRTASLPGHVSEVNTVTFSPDGRTLVTGSGDNSVRVWDVRRPSNPRLVERLSRSAGTN
CCCCCCCCCCCCCCCEEEEECCCCCEEEECCCCCCEEEEEECCCCCHHHHHHHHHHCCCC
SGIGTVAFSRDGSTLVGVVFTEPGALWDLDVDRVAQRICAQAGVGITRDEWARFLPDRAY
CCCEEEEEECCCCEEEEEEEECCCCEEECCHHHHHHHHHHHCCCCCCHHHHHHHCCCCCC
DPPCD
CCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 11759840 [H]