Definition Mesorhizobium sp. BNC1, complete genome.
Accession NC_008254
Length 4,412,446

Click here to switch to the map view.

The map label for this gene is 110632409

Identifier: 110632409

GI number: 110632409

Start: 58073

End: 62398

Strand: Reverse

Name: 110632409

Synonym: Meso_0047

Alternate gene names: NA

Gene position: 62398-58073 (Counterclockwise)

Preceding gene: 110632410

Following gene: 110632408

Centisome position: 1.41

GC content: 63.11

Gene sequence:

>4326_bases
ATGCAGAAGCCGGTCTTTCACTCCGCTGTCGCAAGCAGCTTTCTTAGTCGTCGCCAAAACATAGGTGGGGCGGCAACACG
GCGGCCGGGGGCCGTGCGCCGATATCCCCCTGGTCTTCTCAGGAGTTCCCTTACCGGTTTCTTGTTTTTAGCGGCTTGGG
TTGCGTTCGGCACCACGGAAGAGGCTCGTGCCCAAGCGGGCCCCACCGTCTCGTGCACGACGGACGGCGCCATTTTCAAC
ACGGCATACGATTCCTCGAGTGGCGGCATGCTGACTTCGGGCACCGATGCCAACTGGGACGTCGCCCTGACAACCACGGA
TATTACCGGTCCGCCGCCGGGAGGTCTGACCTACGCCGACGCCGTCGTCGTAGATGATCCACCTGCCAACTACACGACCT
CGCCCTTTGGCAACGCCAACTGGATTTCTCATAACTCCACTGCCACTCAACCCACCCCCGAAAATTACGACATCTTCTAC
CGCTACGAGTTCAGCCTCGATCCCTCGGTCGACCCCTCGACGCTCGATCTGCAGATGACCTTTTTTGCGGATAACTCGGT
TTACGAGGTGTGGGTGAACGGGGTCGACCAGAATATCCAATCCGACTACGCTCCTGAGGATCCGTATTTCTACAGCGGAT
TCCAGGCCGGCAACGGAGCTAGCGGTGCCATGAACGGCGCCTGGCAGACCGGCCTCAACACCATCGTCGTCCACATAAAG
TCCGGACCTGGTGCGCAGGCGTTCATGGCGCAAATCGAGTCGACCTCCGTGTGCCAGCCAACGCTGACCCTGCGGAAGAT
TGTCGACAACTCTCAAGGGGGCAGCGCCGGGCCGGGCGACTTCACCCTGCAGGCTGAGGGGCCGACAACGATTCAAGGCG
TGATGGGCGACCCTGCCGTCACCGATGCGTCGGTCCCGGCGGGCACATATGCGCTGAGCGAGTCCTACACTGAACTTGGC
TATGCTGCTTCCGAGTATAGCTGCGCGATTGACGGCGGGGCAGCAACGGATGGCAATTCCGTGGCATTGGAAAACGGTCA
AAGCGCCGTCTGCACGATCACCAACACATTTTCTCCGTCCTTCGGCTCCTGCAGCCCATCCATGTATCTGGCGCAGAACG
TTCCGACACAGCTCTTCCGCTTCGAAACCTCGGATAACCCGTTCGACGTCAATCCGATAGGGCCAGCCTCGAATAACCAG
TACAACGGCATCGCGATGAACCCCATAGACAACTATATCTATGGCTTCGAGATCAACACTACCCCCCCACGGTTGGCGCG
CGTTGGCAGTGACGGCGGCGTGCAGGTGCTCGGAGAGATTGCCGGCTTTCCGAATGCCACTGTCACAGGTGAATTCAGTC
CGGACGGCACACTCTATTCGGCGACTGCCGGTCGGCTCTATACCGTTAATGTAACAAACAGAACGGCGACATCCGTGCCG
CTGACCGGGGCCGCCACCCACGGTCCGGACCTCGCATGGTATAACGGGCTGCTCTACAGCGTCACCGGTACTGGCCAACT
CGTTACGATCGACCCGGCCACGGGCTTTGTCGACACCGTCGGCGAGACCGGCCTGACACAGAATTCGTTCGGCGGCATGT
TCGGCGCCAGCAACGGCATCTTCGGCTCGAACAATGTTGGCGGCTTCTACCGGTTCAATGTAGAAACAGGCCGCGGAACA
CTCATCTCAGACCTTCAAGGCTCGGGCCAGAACGACGGCGCCAAATGCGCCACCACGCCGCTGACCTTTCCGGCCGACGT
GACGATCGCCAAGGACGACGGCAGCGAGACCTACACGGCGGGCGGCGAGGTGGTTTACACGATCGTCGTTTCCAATGACG
GTCCGTTCGGGGTGGCAGGGACATTGGTGAACGATCCGCTCCCCGACGGTATCACCGATGCGGAGTGGACTTGCGGCAGC
CCGACCGGCGGTGGGTACTGCAGCGTGCCAAGCGGCACGGGCGCCATCACCGACGTGCCGGTGGACCTCCCGGTGGACGG
CGACGTGGGCAGCTCCGTCACCTTCACGCTCACCATGACGGTGCCGGCAGACTTTGAGGGCGATCTCGTCAATACGGCGA
CGGTCACCAACCCATCTGACGTGCCGGATCCCGACCCGAACGACAACGAATCCACGGACACCAACACGGTGCCCGTTATC
CGTAAGGTCAAGGAGCTGGTTGGCGAGAGCGGTGAACTGGCCGGTGTTGCCGAGCCGGGCGAGACGCTCACCTACGAAAT
CACGCTCACCAACCCCTATGACTCGGCGCGCGGCAGTTACGAGCTGATCGACGATTATGACGAAAACCTGACGGTGGTAG
ATGCCGCCGGCGGCACGGACGATGGCGATCTGATCACCTGGACGGGGCTCACCGTTCCGGCGCACGACGGAACCAATCCG
GGCCAACTGGTGCTCACGGTACAGCTCCAGGTCGTCGATCCGATCCCCGAGAGCGTAACCAGGATCAGCAATATCGTCTA
CGAGCCCAATGAGATCGTTGACTGCCGGGTGACGCCCACCCAGTGCTACGAATTGCCGGCCTCCGCGCGTATCCTGCGGA
TGAAGCAATTGGTCGCCGAGGATGGCCTCACGGAAGGTGTTGCCGAGCCGGGCGAAAGGCTCACCTACGAGATCACGCTC
ACCAATACCGGTGGCCCGGCGGACGACTATGCCATCCAGGACCTGCTCGACGAGAACACTGTCTTTGTCTCGGCCGACAA
TGGCGGCACCCACTCGGGGGGCAATCCCGGCGGTGGTGTGGTGGATTGGACCGGGCTCAGCATTCCGGAGCACGACGGGA
CCAATCCGGGCCAACTGGTGCTGACGGTGATAGCGACGGTGGTCGACCCACTGCCCGACGGAGCGATTGGGATATCCAAC
ATGATCAAGGAGCCGGGCGACCCGGATCCCGTATGTCCGTCGGACGACTGTGTGACGGTGCCGTCCCAGTTGACCGGGCT
CGAGTTGGTCAAGACGGGAACCTATGAGGACACCGACGGCAACGGCTTCGCCAATGTGGGTGACACGATCCACTACAAGT
TCACGGTAACCAATACCGGGAACGTGGTGCTGCAGGACGTGGTTCCGGAGGATGCCGGTCCGACATTTGACGGCCAGGAA
GGCGGCGGCGAGCTGTCGGCTTTCGATCCGGCCTCGGCAACGCTGGAGCCGGGCGAGGAGACTGTGTTCGAGGCCAGCTA
TGTCCTGACGCAGGCCGATATCGACAATGGAGCCGGTGTCGAGGAGGGCGTCGAGAACACGGCTACGGCGGTAGGTTATG
CCAATGGCGATCGGGTAACCGGTACGGAGGTGAACTCACCAGGCAGCGGAACCTCTTTGGACTTGCCGGCTGCGGCGAGC
AATATCTCGATTGCGAAGATCGCCAATCTGCGCGCCATCCGGCGCGGCGAGCAGGCGCCGTTCACGATCCGGGTGACGAA
CCTTGCCGGGTCGCGGGTGGACGGGCTGACGGTGGTCGACCGGATCCCGCCGGGCTTCCGCTATGTGGAGGGCTCGGCGA
CGGTCGGCGATGTTGCCGTGGAGCCGGTGGAGGCGGGGCGCGAGATCCGCTTCGAGAACCTGTCGCTGGAAGGCAATCAG
GAAATCGAGATCCGGCTGCGAATGCTGGCCTTGAGCTCGGCGGGTCCCGGCGAGCATGTCAACCGGGCGCGCGCCGAGGA
TGCCTCGGGACGGCAGCTGGCGCCGGAAGCGCAGGCGGTGGTGGAGATCCTGGCGGAGCCGGTGTTCGACTGCGGCGACG
TGATCGGCAAGGTGTTCGACGACGTCAACCGCAACGGCTACCAGGACCAGGGCGAGCCGGGGCTCCCCGGCGTGCGGGTG
GCCACCGTCAAGGGCTGGCTCATCACCACGGATGAATATGGCCGCTTCCATGTGGCCTGCGCCGACCTGCCGGAGGCGCG
CATCGGTTCGAACTTCATCATGAAGCTGGACACGCGCACGCTGCCGACGGGCTATCGCCTGACGACGGAGAACCCGCGCG
TGGTGCGGCTGACGGCGGGCAAGACGACGAAGCTGAACTTCGGCGCCGCGGTGGGACGCGTCGTCCGTCTGGAATTGACG
GACGCGGCCTTCGCGCCGGACGCCGCGCAGCTGAAGCCGGAATGGGCAGAGAGCGTCGACCGGCTGATCGGCGTCCTTGC
CGAGGAGCAGTCGGTGCTGCGGCTGACCTACTTCTACGGCGGTGTCGACCGGGCATTGGCCGGCGCGCGGATCATGCAGG
CGAGAGAGCTGATCGCGGAACGCTGGCGCAGGAGAGGAGGTGCTTACCGACTGGAGATCGAGATGCGAGTGGAGGCGGTT
CAATGA

Upstream 100 bases:

>100_bases
CGGCGTCCGGGATCGAGGGGGATCCCATGCCATGCCAGGGCGGTCCGAGGTTGTCGCTCGGAAAACCGCAACGGACGATT
CACATACGAGGGAGTCGTCC

Downstream 100 bases:

>100_bases
GCGCGCTGATCGGGAAGACGGGCATGAATACCACGCATATTGTTTGCCGCAATCGCACGCTCCTGCTGGCCGGCATCGCG
CTCATGGCGCTTGTCGGCAG

Product: hypothetical protein

Products: NA

Alternate protein names: Hemagglutinin/Hemolysin-Like Protein; OmpA Family Outer Membrane Protein; Conserved Repeat Domain

Number of amino acids: Translated: 1441; Mature: 1441

Protein sequence:

>1441_residues
MQKPVFHSAVASSFLSRRQNIGGAATRRPGAVRRYPPGLLRSSLTGFLFLAAWVAFGTTEEARAQAGPTVSCTTDGAIFN
TAYDSSSGGMLTSGTDANWDVALTTTDITGPPPGGLTYADAVVVDDPPANYTTSPFGNANWISHNSTATQPTPENYDIFY
RYEFSLDPSVDPSTLDLQMTFFADNSVYEVWVNGVDQNIQSDYAPEDPYFYSGFQAGNGASGAMNGAWQTGLNTIVVHIK
SGPGAQAFMAQIESTSVCQPTLTLRKIVDNSQGGSAGPGDFTLQAEGPTTIQGVMGDPAVTDASVPAGTYALSESYTELG
YAASEYSCAIDGGAATDGNSVALENGQSAVCTITNTFSPSFGSCSPSMYLAQNVPTQLFRFETSDNPFDVNPIGPASNNQ
YNGIAMNPIDNYIYGFEINTTPPRLARVGSDGGVQVLGEIAGFPNATVTGEFSPDGTLYSATAGRLYTVNVTNRTATSVP
LTGAATHGPDLAWYNGLLYSVTGTGQLVTIDPATGFVDTVGETGLTQNSFGGMFGASNGIFGSNNVGGFYRFNVETGRGT
LISDLQGSGQNDGAKCATTPLTFPADVTIAKDDGSETYTAGGEVVYTIVVSNDGPFGVAGTLVNDPLPDGITDAEWTCGS
PTGGGYCSVPSGTGAITDVPVDLPVDGDVGSSVTFTLTMTVPADFEGDLVNTATVTNPSDVPDPDPNDNESTDTNTVPVI
RKVKELVGESGELAGVAEPGETLTYEITLTNPYDSARGSYELIDDYDENLTVVDAAGGTDDGDLITWTGLTVPAHDGTNP
GQLVLTVQLQVVDPIPESVTRISNIVYEPNEIVDCRVTPTQCYELPASARILRMKQLVAEDGLTEGVAEPGERLTYEITL
TNTGGPADDYAIQDLLDENTVFVSADNGGTHSGGNPGGGVVDWTGLSIPEHDGTNPGQLVLTVIATVVDPLPDGAIGISN
MIKEPGDPDPVCPSDDCVTVPSQLTGLELVKTGTYEDTDGNGFANVGDTIHYKFTVTNTGNVVLQDVVPEDAGPTFDGQE
GGGELSAFDPASATLEPGEETVFEASYVLTQADIDNGAGVEEGVENTATAVGYANGDRVTGTEVNSPGSGTSLDLPAAAS
NISIAKIANLRAIRRGEQAPFTIRVTNLAGSRVDGLTVVDRIPPGFRYVEGSATVGDVAVEPVEAGREIRFENLSLEGNQ
EIEIRLRMLALSSAGPGEHVNRARAEDASGRQLAPEAQAVVEILAEPVFDCGDVIGKVFDDVNRNGYQDQGEPGLPGVRV
ATVKGWLITTDEYGRFHVACADLPEARIGSNFIMKLDTRTLPTGYRLTTENPRVVRLTAGKTTKLNFGAAVGRVVRLELT
DAAFAPDAAQLKPEWAESVDRLIGVLAEEQSVLRLTYFYGGVDRALAGARIMQARELIAERWRRRGGAYRLEIEMRVEAV
Q

Sequences:

>Translated_1441_residues
MQKPVFHSAVASSFLSRRQNIGGAATRRPGAVRRYPPGLLRSSLTGFLFLAAWVAFGTTEEARAQAGPTVSCTTDGAIFN
TAYDSSSGGMLTSGTDANWDVALTTTDITGPPPGGLTYADAVVVDDPPANYTTSPFGNANWISHNSTATQPTPENYDIFY
RYEFSLDPSVDPSTLDLQMTFFADNSVYEVWVNGVDQNIQSDYAPEDPYFYSGFQAGNGASGAMNGAWQTGLNTIVVHIK
SGPGAQAFMAQIESTSVCQPTLTLRKIVDNSQGGSAGPGDFTLQAEGPTTIQGVMGDPAVTDASVPAGTYALSESYTELG
YAASEYSCAIDGGAATDGNSVALENGQSAVCTITNTFSPSFGSCSPSMYLAQNVPTQLFRFETSDNPFDVNPIGPASNNQ
YNGIAMNPIDNYIYGFEINTTPPRLARVGSDGGVQVLGEIAGFPNATVTGEFSPDGTLYSATAGRLYTVNVTNRTATSVP
LTGAATHGPDLAWYNGLLYSVTGTGQLVTIDPATGFVDTVGETGLTQNSFGGMFGASNGIFGSNNVGGFYRFNVETGRGT
LISDLQGSGQNDGAKCATTPLTFPADVTIAKDDGSETYTAGGEVVYTIVVSNDGPFGVAGTLVNDPLPDGITDAEWTCGS
PTGGGYCSVPSGTGAITDVPVDLPVDGDVGSSVTFTLTMTVPADFEGDLVNTATVTNPSDVPDPDPNDNESTDTNTVPVI
RKVKELVGESGELAGVAEPGETLTYEITLTNPYDSARGSYELIDDYDENLTVVDAAGGTDDGDLITWTGLTVPAHDGTNP
GQLVLTVQLQVVDPIPESVTRISNIVYEPNEIVDCRVTPTQCYELPASARILRMKQLVAEDGLTEGVAEPGERLTYEITL
TNTGGPADDYAIQDLLDENTVFVSADNGGTHSGGNPGGGVVDWTGLSIPEHDGTNPGQLVLTVIATVVDPLPDGAIGISN
MIKEPGDPDPVCPSDDCVTVPSQLTGLELVKTGTYEDTDGNGFANVGDTIHYKFTVTNTGNVVLQDVVPEDAGPTFDGQE
GGGELSAFDPASATLEPGEETVFEASYVLTQADIDNGAGVEEGVENTATAVGYANGDRVTGTEVNSPGSGTSLDLPAAAS
NISIAKIANLRAIRRGEQAPFTIRVTNLAGSRVDGLTVVDRIPPGFRYVEGSATVGDVAVEPVEAGREIRFENLSLEGNQ
EIEIRLRMLALSSAGPGEHVNRARAEDASGRQLAPEAQAVVEILAEPVFDCGDVIGKVFDDVNRNGYQDQGEPGLPGVRV
ATVKGWLITTDEYGRFHVACADLPEARIGSNFIMKLDTRTLPTGYRLTTENPRVVRLTAGKTTKLNFGAAVGRVVRLELT
DAAFAPDAAQLKPEWAESVDRLIGVLAEEQSVLRLTYFYGGVDRALAGARIMQARELIAERWRRRGGAYRLEIEMRVEAV
Q
>Mature_1441_residues
MQKPVFHSAVASSFLSRRQNIGGAATRRPGAVRRYPPGLLRSSLTGFLFLAAWVAFGTTEEARAQAGPTVSCTTDGAIFN
TAYDSSSGGMLTSGTDANWDVALTTTDITGPPPGGLTYADAVVVDDPPANYTTSPFGNANWISHNSTATQPTPENYDIFY
RYEFSLDPSVDPSTLDLQMTFFADNSVYEVWVNGVDQNIQSDYAPEDPYFYSGFQAGNGASGAMNGAWQTGLNTIVVHIK
SGPGAQAFMAQIESTSVCQPTLTLRKIVDNSQGGSAGPGDFTLQAEGPTTIQGVMGDPAVTDASVPAGTYALSESYTELG
YAASEYSCAIDGGAATDGNSVALENGQSAVCTITNTFSPSFGSCSPSMYLAQNVPTQLFRFETSDNPFDVNPIGPASNNQ
YNGIAMNPIDNYIYGFEINTTPPRLARVGSDGGVQVLGEIAGFPNATVTGEFSPDGTLYSATAGRLYTVNVTNRTATSVP
LTGAATHGPDLAWYNGLLYSVTGTGQLVTIDPATGFVDTVGETGLTQNSFGGMFGASNGIFGSNNVGGFYRFNVETGRGT
LISDLQGSGQNDGAKCATTPLTFPADVTIAKDDGSETYTAGGEVVYTIVVSNDGPFGVAGTLVNDPLPDGITDAEWTCGS
PTGGGYCSVPSGTGAITDVPVDLPVDGDVGSSVTFTLTMTVPADFEGDLVNTATVTNPSDVPDPDPNDNESTDTNTVPVI
RKVKELVGESGELAGVAEPGETLTYEITLTNPYDSARGSYELIDDYDENLTVVDAAGGTDDGDLITWTGLTVPAHDGTNP
GQLVLTVQLQVVDPIPESVTRISNIVYEPNEIVDCRVTPTQCYELPASARILRMKQLVAEDGLTEGVAEPGERLTYEITL
TNTGGPADDYAIQDLLDENTVFVSADNGGTHSGGNPGGGVVDWTGLSIPEHDGTNPGQLVLTVIATVVDPLPDGAIGISN
MIKEPGDPDPVCPSDDCVTVPSQLTGLELVKTGTYEDTDGNGFANVGDTIHYKFTVTNTGNVVLQDVVPEDAGPTFDGQE
GGGELSAFDPASATLEPGEETVFEASYVLTQADIDNGAGVEEGVENTATAVGYANGDRVTGTEVNSPGSGTSLDLPAAAS
NISIAKIANLRAIRRGEQAPFTIRVTNLAGSRVDGLTVVDRIPPGFRYVEGSATVGDVAVEPVEAGREIRFENLSLEGNQ
EIEIRLRMLALSSAGPGEHVNRARAEDASGRQLAPEAQAVVEILAEPVFDCGDVIGKVFDDVNRNGYQDQGEPGLPGVRV
ATVKGWLITTDEYGRFHVACADLPEARIGSNFIMKLDTRTLPTGYRLTTENPRVVRLTAGKTTKLNFGAAVGRVVRLELT
DAAFAPDAAQLKPEWAESVDRLIGVLAEEQSVLRLTYFYGGVDRALAGARIMQARELIAERWRRRGGAYRLEIEMRVEAV
Q

Specific function: Unknown

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 151328; Mature: 151328

Theoretical pI: Translated: 3.95; Mature: 3.95

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.0 %Cys     (Translated Protein)
1.1 %Met     (Translated Protein)
2.1 %Cys+Met (Translated Protein)
1.0 %Cys     (Mature Protein)
1.1 %Met     (Mature Protein)
2.1 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MQKPVFHSAVASSFLSRRQNIGGAATRRPGAVRRYPPGLLRSSLTGFLFLAAWVAFGTTE
CCCCHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHCCCCH
EARAQAGPTVSCTTDGAIFNTAYDSSSGGMLTSGTDANWDVALTTTDITGPPPGGLTYAD
HHHHHCCCEEEEECCCEEEEEECCCCCCCEEECCCCCCEEEEEEEEECCCCCCCCCEEEE
AVVVDDPPANYTTSPFGNANWISHNSTATQPTPENYDIFYRYEFSLDPSVDPSTLDLQMT
EEEECCCCCCCCCCCCCCCCEEECCCCCCCCCCCCCEEEEEEEEECCCCCCCCEEEEEEE
FFADNSVYEVWVNGVDQNIQSDYAPEDPYFYSGFQAGNGASGAMNGAWQTGLNTIVVHIK
EEECCCEEEEEECCCCCCHHCCCCCCCCEEECCCCCCCCCCCCCCCHHHCCCEEEEEEEE
SGPGAQAFMAQIESTSVCQPTLTLRKIVDNSQGGSAGPGDFTLQAEGPTTIQGVMGDPAV
CCCCHHHHHHHHCCCCCCCHHHHHHHHHCCCCCCCCCCCCEEEEECCCCEEEECCCCCCC
TDASVPAGTYALSESYTELGYAASEYSCAIDGGAATDGNSVALENGQSAVCTITNTFSPS
CCCCCCCCEEEHHCCHHHHCCCCCCCEEEECCCCCCCCCEEEEECCCEEEEEEEECCCCC
FGSCSPSMYLAQNVPTQLFRFETSDNPFDVNPIGPASNNQYNGIAMNPIDNYIYGFEINT
CCCCCCCEEEECCCCCEEEEEECCCCCEECCCCCCCCCCCCCCEEECCHHCEEEEEEECC
TPPRLARVGSDGGVQVLGEIAGFPNATVTGEFSPDGTLYSATAGRLYTVNVTNRTATSVP
CCHHHEECCCCCCHHHHHHHCCCCCCEEEECCCCCCCEEEECCCEEEEEEECCCEECCCC
LTGAATHGPDLAWYNGLLYSVTGTGQLVTIDPATGFVDTVGETGLTQNSFGGMFGASNGI
CCCCCCCCCCCHHHCCEEEEEECCCEEEEECCCCCCHHHCCCCCCCCCCCCCCCCCCCCC
FGSNNVGGFYRFNVETGRGTLISDLQGSGQNDGAKCATTPLTFPADVTIAKDDGSETYTA
CCCCCCCEEEEEEEECCCCEEEECCCCCCCCCCCEEEECCCCCCCEEEEEECCCCCEEEC
GGEVVYTIVVSNDGPFGVAGTLVNDPLPDGITDAEWTCGSPTGGGYCSVPSGTGAITDVP
CCEEEEEEEEECCCCCCEEEEEECCCCCCCCCCCCEECCCCCCCCEEECCCCCCCEEECC
VDLPVDGDVGSSVTFTLTMTVPADFEGDLVNTATVTNPSDVPDPDPNDNESTDTNTVPVI
EECCCCCCCCCEEEEEEEEEECCCCCCCEEEEEEECCCCCCCCCCCCCCCCCCCCCHHHH
RKVKELVGESGELAGVAEPGETLTYEITLTNPYDSARGSYELIDDYDENLTVVDAAGGTD
HHHHHHHCCCCCEEEECCCCCEEEEEEEEECCCCCCCCCEEEECCCCCCEEEEECCCCCC
DGDLITWTGLTVPAHDGTNPGQLVLTVQLQVVDPIPESVTRISNIVYEPNEIVDCRVTPT
CCCEEEEECEEEECCCCCCCCEEEEEEEEEEECCCHHHHHHHHHHEECCCCEEEEEECHH
QCYELPASARILRMKQLVAEDGLTEGVAEPGERLTYEITLTNTGGPADDYAIQDLLDENT
HHHCCCCHHHHHHHHHHHHHCCCHHHHCCCCCEEEEEEEEECCCCCCCHHHHHHHCCCCE
VFVSADNGGTHSGGNPGGGVVDWTGLSIPEHDGTNPGQLVLTVIATVVDPLPDGAIGISN
EEEECCCCCCCCCCCCCCCEEEECCCCCCCCCCCCHHHHHHHHHHHHHCCCCCCCCCHHH
MIKEPGDPDPVCPSDDCVTVPSQLTGLELVKTGTYEDTDGNGFANVGDTIHYKFTVTNTG
HHCCCCCCCCCCCCCCCEECCCCCCCEEEEECCCCCCCCCCCCCCCCCEEEEEEEEECCC
NVVLQDVVPEDAGPTFDGQEGGGELSAFDPASATLEPGEETVFEASYVLTQADIDNGAGV
CEEEEECCCCCCCCCCCCCCCCCCEEECCCCCCCCCCCHHHEEEEEEEEEEECCCCCCCH
EEGVENTATAVGYANGDRVTGTEVNSPGSGTSLDLPAAASNISIAKIANLRAIRRGEQAP
HHHHHHCEEEEEECCCCEEECCCCCCCCCCCEEECCCCCCCCCHHHHHHHHHHHCCCCCC
FTIRVTNLAGSRVDGLTVVDRIPPGFRYVEGSATVGDVAVEPVEAGREIRFENLSLEGNQ
EEEEEEECCCCCCCCEEEEECCCCCCEEEECCCCCCCEEECHHHCCCEEEEEEECCCCCC
EIEIRLRMLALSSAGPGEHVNRARAEDASGRQLAPEAQAVVEILAEPVFDCGDVIGKVFD
EEEEEEEEEEECCCCCCHHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHH
DVNRNGYQDQGEPGLPGVRVATVKGWLITTDEYGRFHVACADLPEARIGSNFIMKLDTRT
HHCCCCCCCCCCCCCCCEEEEEEEEEEEECCCCCEEEEEECCCCCCCCCCCEEEEEECCC
LPTGYRLTTENPRVVRLTAGKTTKLNFGAAVGRVVRLELTDAAFAPDAAQLKPEWAESVD
CCCCEEEECCCCEEEEEECCCCEEEECCCCCCEEEEEEEECCCCCCCHHHCCCHHHHHHH
RLIGVLAEEQSVLRLTYFYGGVDRALAGARIMQARELIAERWRRRGGAYRLEIEMRVEAV
HHHHHHHCCCCEEEEEEECCCHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEEEEEEEEEC
Q
C
>Mature Secondary Structure
MQKPVFHSAVASSFLSRRQNIGGAATRRPGAVRRYPPGLLRSSLTGFLFLAAWVAFGTTE
CCCCHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHCCCCH
EARAQAGPTVSCTTDGAIFNTAYDSSSGGMLTSGTDANWDVALTTTDITGPPPGGLTYAD
HHHHHCCCEEEEECCCEEEEEECCCCCCCEEECCCCCCEEEEEEEEECCCCCCCCCEEEE
AVVVDDPPANYTTSPFGNANWISHNSTATQPTPENYDIFYRYEFSLDPSVDPSTLDLQMT
EEEECCCCCCCCCCCCCCCCEEECCCCCCCCCCCCCEEEEEEEEECCCCCCCCEEEEEEE
FFADNSVYEVWVNGVDQNIQSDYAPEDPYFYSGFQAGNGASGAMNGAWQTGLNTIVVHIK
EEECCCEEEEEECCCCCCHHCCCCCCCCEEECCCCCCCCCCCCCCCHHHCCCEEEEEEEE
SGPGAQAFMAQIESTSVCQPTLTLRKIVDNSQGGSAGPGDFTLQAEGPTTIQGVMGDPAV
CCCCHHHHHHHHCCCCCCCHHHHHHHHHCCCCCCCCCCCCEEEEECCCCEEEECCCCCCC
TDASVPAGTYALSESYTELGYAASEYSCAIDGGAATDGNSVALENGQSAVCTITNTFSPS
CCCCCCCCEEEHHCCHHHHCCCCCCCEEEECCCCCCCCCEEEEECCCEEEEEEEECCCCC
FGSCSPSMYLAQNVPTQLFRFETSDNPFDVNPIGPASNNQYNGIAMNPIDNYIYGFEINT
CCCCCCCEEEECCCCCEEEEEECCCCCEECCCCCCCCCCCCCCEEECCHHCEEEEEEECC
TPPRLARVGSDGGVQVLGEIAGFPNATVTGEFSPDGTLYSATAGRLYTVNVTNRTATSVP
CCHHHEECCCCCCHHHHHHHCCCCCCEEEECCCCCCCEEEECCCEEEEEEECCCEECCCC
LTGAATHGPDLAWYNGLLYSVTGTGQLVTIDPATGFVDTVGETGLTQNSFGGMFGASNGI
CCCCCCCCCCCHHHCCEEEEEECCCEEEEECCCCCCHHHCCCCCCCCCCCCCCCCCCCCC
FGSNNVGGFYRFNVETGRGTLISDLQGSGQNDGAKCATTPLTFPADVTIAKDDGSETYTA
CCCCCCCEEEEEEEECCCCEEEECCCCCCCCCCCEEEECCCCCCCEEEEEECCCCCEEEC
GGEVVYTIVVSNDGPFGVAGTLVNDPLPDGITDAEWTCGSPTGGGYCSVPSGTGAITDVP
CCEEEEEEEEECCCCCCEEEEEECCCCCCCCCCCCEECCCCCCCCEEECCCCCCCEEECC
VDLPVDGDVGSSVTFTLTMTVPADFEGDLVNTATVTNPSDVPDPDPNDNESTDTNTVPVI
EECCCCCCCCCEEEEEEEEEECCCCCCCEEEEEEECCCCCCCCCCCCCCCCCCCCCHHHH
RKVKELVGESGELAGVAEPGETLTYEITLTNPYDSARGSYELIDDYDENLTVVDAAGGTD
HHHHHHHCCCCCEEEECCCCCEEEEEEEEECCCCCCCCCEEEECCCCCCEEEEECCCCCC
DGDLITWTGLTVPAHDGTNPGQLVLTVQLQVVDPIPESVTRISNIVYEPNEIVDCRVTPT
CCCEEEEECEEEECCCCCCCCEEEEEEEEEEECCCHHHHHHHHHHEECCCCEEEEEECHH
QCYELPASARILRMKQLVAEDGLTEGVAEPGERLTYEITLTNTGGPADDYAIQDLLDENT
HHHCCCCHHHHHHHHHHHHHCCCHHHHCCCCCEEEEEEEEECCCCCCCHHHHHHHCCCCE
VFVSADNGGTHSGGNPGGGVVDWTGLSIPEHDGTNPGQLVLTVIATVVDPLPDGAIGISN
EEEECCCCCCCCCCCCCCCEEEECCCCCCCCCCCCHHHHHHHHHHHHHCCCCCCCCCHHH
MIKEPGDPDPVCPSDDCVTVPSQLTGLELVKTGTYEDTDGNGFANVGDTIHYKFTVTNTG
HHCCCCCCCCCCCCCCCEECCCCCCCEEEEECCCCCCCCCCCCCCCCCEEEEEEEEECCC
NVVLQDVVPEDAGPTFDGQEGGGELSAFDPASATLEPGEETVFEASYVLTQADIDNGAGV
CEEEEECCCCCCCCCCCCCCCCCCEEECCCCCCCCCCCHHHEEEEEEEEEEECCCCCCCH
EEGVENTATAVGYANGDRVTGTEVNSPGSGTSLDLPAAASNISIAKIANLRAIRRGEQAP
HHHHHHCEEEEEECCCCEEECCCCCCCCCCCEEECCCCCCCCCHHHHHHHHHHHCCCCCC
FTIRVTNLAGSRVDGLTVVDRIPPGFRYVEGSATVGDVAVEPVEAGREIRFENLSLEGNQ
EEEEEEECCCCCCCCEEEEECCCCCCEEEECCCCCCCEEECHHHCCCEEEEEEECCCCCC
EIEIRLRMLALSSAGPGEHVNRARAEDASGRQLAPEAQAVVEILAEPVFDCGDVIGKVFD
EEEEEEEEEEECCCCCCHHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHH
DVNRNGYQDQGEPGLPGVRVATVKGWLITTDEYGRFHVACADLPEARIGSNFIMKLDTRT
HHCCCCCCCCCCCCCCCEEEEEEEEEEEECCCCCEEEEEECCCCCCCCCCCEEEEEECCC
LPTGYRLTTENPRVVRLTAGKTTKLNFGAAVGRVVRLELTDAAFAPDAAQLKPEWAESVD
CCCCEEEECCCCEEEEEECCCCEEEECCCCCCEEEEEEEECCCCCCCHHHCCCHHHHHHH
RLIGVLAEEQSVLRLTYFYGGVDRALAGARIMQARELIAERWRRRGGAYRLEIEMRVEAV
HHHHHHHCCCCEEEEEEECCCHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEEEEEEEEEC
Q
C

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA