Definition Burkholderia pseudomallei K96243 chromosome 2, complete sequence.
Accession NC_006351
Length 3,173,005

Click here to switch to the map view.

The map label for this gene is bcsC [H]

Identifier: 53722602

GI number: 53722602

Start: 2145560

End: 2150062

Strand: Reverse

Name: bcsC [H]

Synonym: BPSS1580

Alternate gene names: 53722602

Gene position: 2150062-2145560 (Counterclockwise)

Preceding gene: 53722603

Following gene: 53722601

Centisome position: 67.76

GC content: 76.22

Gene sequence:

>4503_bases
TTGACGGCGGGGCCGCAGACGAGGCGGCGCGCGCGGCGCGGCGCGGGCTGCGCCGGGATCGCGGCCGTCGCGGCGATCGC
GTTCGCCGTGCCATGCTTCGCGTCCGCCGCGGCGGACGACGTTGCTGCGCGGTGGGCGGCATCGGAACGATCGCTCGCCG
ATGCGCACGCTTGCGCCGGTGTGCGCTCGGCCGCGCCCGGATGGGCGGTTTCGATGGAGGCGGCGGCGCCGCCGCCGCGG
TTCGTGCCGCCGGGCCCGAATACGTCGCCGGGCGCGATGCAGGCGAATGTCGAAGCGATGTCGCCGGCCGCGCCGGCGCG
GGCTGGGGCGATGGTGCGAGCGTCGTCGGCGCGGCTTGAGCCGGCTCCGAGCGCGTCTGTCGATGCGTCTTCGGCGAATG
TCGAGGCGATGCCGCCGGCCGCGCCGGCGCAGGCCGCCGCGATGACGCAGGCGTCGCCTGTTCGGCCTGCGTCGGTGCCG
CGCGCGTCGTTCGATGCGCCGTCCGCGCAGGCAGGCTCGATGCCGCCGGACACGGCGCATCGTCACGCGTCGGCGGCCTC
GTCGCTCGCGCGCACGACCGCGCCGGCGTTGCCGTTCGCGCCGGCCGGCTTCGCGTCGGCCGCGCTTCGCGCGTTCGCGC
CGACGTATCCAATGTCGCTCATGTCGCCCACGTCGCCGAAGCAAACGCCGCCGGTCCGCTTCGTGCCCACGTCGCCGCGT
GGCGCGCCGGCGACGCCGCAGCCCGTCGCGACGCCGCACGCGCCCGACGCTGATGCCGTGCGCGCGCTGTACGCGACGGC
GCGCATGTGGGCGAACAAGCATCGCGACGACCTCGCGCGCGACGCGCTGCGCAAGGCGCTGCTGATCGCGCCGCGCGATC
CGGCGCTGCTCGCCGAGCACACGCGGATCCTGCTGCGCGTCGGCGACGCGAAGGGCGCGCGCGCGTCGCTCGAACGCCTG
AAGCAGGCGGCGCCCGGCGCGCTCGCGACGCGCCAGGTCGACGACGAATACCGCGTCGCGACGAGCGGCCGCGAGGAGAT
GGCGCAGATTCGGCTGCTCGCGCGCAGCGGGCGCGGTGACGAAGCGGCCCGCCGCATCGTCGCGCTGTTCCCGCACGGCG
CGCCGGCGGGCTCGCTCGGCGCCGAGTATTACCAGATCGTCGCGAGCGCGCCCGACGGCCGCGCGCGCGCGATCGACGCG
CTGCGCCGGGCCGTCGCCGCCGATCCGGCGGACGCCGACGCGGCGACGGTGCTCGCGAAGCTGCTGAACCAGCGCGACGA
CACGCGCGCGCAAGCGAACCGGCTCGCGTGGGCGCTCGTCGCGCGGCCGGATACGGACCGGCGCGCCTCGCTCGCGCTGT
GGCGCAGCGTGCTGCAGTCGGCCGGGCGCGACCTCGCGTATCTCGACGCATTGCGCGCCTATCTGACGTTCGCACCCGAG
GACGACGAGTTTCGCGGTAACGCCGCCGCGCTCGAGCAGCAGCGCGACGCGCGGCTTCGCCTCGCGCGCGATCCGGACTA
CATCGCGCAGCAGCGCGGCCTGCAGGCGCTTGCGCGCGGCGATCCGGCGGCCGCCGAGCCGCTCCTCGCGCGTGCCGCGG
CCGCGCGCGCGGGCGATCCGGACGCGCTCGGCGGCCTTGGGCTGCTGCGGCTGCGGCAGGGCCGCCACGACGAAGCGCGC
GCGCTGTTCGTGCGCGCGGCCGCGCTCGCGCCGGACAATCGCGCGAAGTGGGTGGGGCTCGCGGGCACCGCGCGCTTCTG
GGGCACGCTTGCGCAGGGCCGCGCGGCCGCCGCGCAAGGGCGCCCGGACGACGCGCAGCGCGCCGCGCGCGCGGCGCTCG
CGCTCGATCCGCAGAGCGCCGACGCGAAGCTGCTGCTCGCCGATTCGCTGCTCGCGCGGCGCGACTGGCGCGCCGCGCAG
CCGCTGCTGCGCGCGCTGCTCGACGCGCGCGCGCCGAGCGTGTCTGCCGTGCGCAGCATGCGCACGCTATACGAGCAAAC
CGGCCGCGCCGACGCGTTCGGGCCGCTCGTCGACGCGCTGCAAAGCCGCTTCGCCGCGCCCGACGATCGCGCGGCGCTGT
CGCGGCTGCGCGCCGAGTGGCTCGCGCAGCAGGCCGACGCGCTCGCGGCGGCGGGCCAGCGCGGGCCGGCCGCGCAGCGC
TACGAGGCGTCGCTGCGCATCGCGCCCGATGCGCCGTGGGCGCGCTTCGCGCTCGCGCGGCTGTATCGCGACATGGGCCT
GCCGCAGCTCGGCCGCGCGGTGATGGACGAGGGGCTCGCCGGGTCGGATGCGGCCGACATGCGCTACGCGGCCGCGCTCT
ATCGACACGCGCTCGACGACGTCGCGGGGGCGCGGGCCGCGTTCGCGGCGATCGCGGACGCGAGCCGCACGCAAGGCATG
CGCGCGTTCGCACGCAAGCTCGATGCCGAGGCGGCGCTTGCCGATGCGCGGGCCGCGCTCGCGCGCGAGGACCGCGCGGC
GGCTCATGCCGCGCTCGAGCGCGCGCGCCGCGCCGCGCCCGACGATCCGGACATGCTCGCCGCAGTCGGGGCGCAGTGGA
TCGATATCGGCGAAATCGAGCGCGGTCTCGCGCCGCTGCGCGACTGGATTGCCGTGCATCCGCGCGAGGCCGACGCCGAC
GTGCGGCTGCGCTACGGCGACCTGCTCGGCGGCGCGCGGCGCGACGACGCACTGGCCGCCTGGCTCGACACGCTGCGCCG
CGGCGGCGCGCCGCTCGACGCCGCGCAAAGCGCGCGCCTCGAGGATCAGGCGCTGCGGCTCGTGCTGCGCGAAACCGACG
ACGCGCTCGATCGCGACGATTACGAGGCGGCCGCGCGCGCGCTCGATCGCGCGAGCCCGGCGGGCAAGGCCGATCGCCGC
TATGCGCTCGAGGCGGCCGAGCTCGCGCGCACGCAGGGGCGCTACGACGCCGCGCGCGCGGCGCTCGCGCCGCTGCTCGC
GCGCGCGCCCGACGACGCCGACGCGCAGCTCGCGCTCGCGCGCATTCTCGACGACGACGGCGCGCCCGCGGATGCGCTCG
CGCTCGTGCGCGACGTGCTCGCGCGCACGCCGCCCGACGATGTCGACACGCAGCTGTCCGCGCTGCGCCGGCTGACCGCG
CTGCGCCGCGCGCGGGATGCGGCCGCGCTCGCCGACACGCTGCGCGCCGCCTATCCGGCGCGCGCGGACGTGACGGTCGC
GGCCGGGCGGGTCGCGCAGGCGCTCGGCCGCTATGACGACGCGGCGTCGCTGTACCGGCTGTCGCTCGCGCAGGAACGCG
CGACGGGCATCGCCCCGCGCCGCGACGGCGCGACGCCCGCGCAGGCCGCATGGGCCGACTTGCAGCAGCGCCGCGATCCG
CAGATCGAAGCGGGGTGGCTGCCCGCGTACAAGTCCGGCGACGAGGGCGTGTCCGCGTATCGCGCGCATCAGATGCCGGT
TTATCTGCAGATGCCGTATCGCTACGACGGTCACGCGTTCGTTCATCTCGACGCGGTGCGGCTCGACGCGGGCACGCTCG
ATACGAGCGATCCGCGCGCGTATGCGTTCGACACGTTCGCGACGCATCCGGCGCTCGCCGACGCAGCCGCGCCGGGCGGC
GCGCTGCGCCAGCGCGCGGCGGGCATCGGCGGCGGCATCGGCTATCGCGACGACGCGTGGCGCGTCGACGTCGGCACGAC
GCCGCTCGGCTTTCCGGTGCATTACGTCGTCGGCGGCGTGCGCTACCGGTTCGACGCGGGCCCGGCGAGCGTCACCGTCA
GCGCGGCGCGGCGGCCGGAGACGGGCAGCGTGCTGTCGTACGCGGGGCTGCGCGATCCGTGGACGGGCGCGACCTGGGGC
GGCGTGCGGCGCGATAGCGTCGGCGTGCGCGCATCCGTCGACATCGGCCGCGTGAATCTGTTCGCCGATCTCGCCGCCGC
GCGACTGACCGGGCGCAACGTCGCCGAGAACGCGGCCGTCACGCTGCGCACGGGCTTCATGGCGCCCGTCTATCGGCGCG
CGGACATGCGCGTGAGCGCGGGGCTCGTCGGCAACGCGTGGCACTACGCGCAGAACCTGCGCTACTACACGTACGGGCAG
GGCGGCTACTACAGCCCGCAGCGCTACCTGTCGATCGGCATGCCGCTCGAATGGGCGGGGCGGCGCGGCGCGTTCACGTG
GGACGTGACCGCGACGGTCGGCGTGTCGAATTCGTACGAGCGCGATTCGCCGTATTTTCCGAATGGGCTGCCGGGCTCGA
CGCTCGTCAAGTCCGCGCCGGCGCTCGGCAACCCGGTGTTCTCGCGCGGCTCGACGCGCGGCGTGTCGTTCTGGTACGGG
TTCGCGGGCGTCGCCGAGTATCGCGTGAACGGGCGGCTCGCCGTGGGCGCGCGATTCGATATCGACCACGCGCACGACTA
CGCGCCGAGCGCCGGGCTGCTGTACGTGCGCTATGCGTTCGACGCGCGCAAGGACAGCGGCGGCTTCTCGCCGTCGCCGG
TCCGACTCTATTCGAGCTACTGA

Upstream 100 bases:

>100_bases
TGACGCTGTTCGGGCTCGGCTGGCGCGACGGGCGCTACCGGTTCGCGGCCGACGGCACGCTGCGGGTGCGATGGAGCGAG
CCGTGCTCGACGCCCGCGCG

Downstream 100 bases:

>100_bases
TGGATGCGACATGAACGACTCATGCGTGAAATCCCCGGACCCGGTGCCCGGCCGGCCCGCGAGCGGCGGGGCCGGTGCGC
GCGCGCTCGCCCGCCTGCGC

Product: cellulose biosynthesis protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 1500; Mature: 1499

Protein sequence:

>1500_residues
MTAGPQTRRRARRGAGCAGIAAVAAIAFAVPCFASAAADDVAARWAASERSLADAHACAGVRSAAPGWAVSMEAAAPPPR
FVPPGPNTSPGAMQANVEAMSPAAPARAGAMVRASSARLEPAPSASVDASSANVEAMPPAAPAQAAAMTQASPVRPASVP
RASFDAPSAQAGSMPPDTAHRHASAASSLARTTAPALPFAPAGFASAALRAFAPTYPMSLMSPTSPKQTPPVRFVPTSPR
GAPATPQPVATPHAPDADAVRALYATARMWANKHRDDLARDALRKALLIAPRDPALLAEHTRILLRVGDAKGARASLERL
KQAAPGALATRQVDDEYRVATSGREEMAQIRLLARSGRGDEAARRIVALFPHGAPAGSLGAEYYQIVASAPDGRARAIDA
LRRAVAADPADADAATVLAKLLNQRDDTRAQANRLAWALVARPDTDRRASLALWRSVLQSAGRDLAYLDALRAYLTFAPE
DDEFRGNAAALEQQRDARLRLARDPDYIAQQRGLQALARGDPAAAEPLLARAAAARAGDPDALGGLGLLRLRQGRHDEAR
ALFVRAAALAPDNRAKWVGLAGTARFWGTLAQGRAAAAQGRPDDAQRAARAALALDPQSADAKLLLADSLLARRDWRAAQ
PLLRALLDARAPSVSAVRSMRTLYEQTGRADAFGPLVDALQSRFAAPDDRAALSRLRAEWLAQQADALAAAGQRGPAAQR
YEASLRIAPDAPWARFALARLYRDMGLPQLGRAVMDEGLAGSDAADMRYAAALYRHALDDVAGARAAFAAIADASRTQGM
RAFARKLDAEAALADARAALAREDRAAAHAALERARRAAPDDPDMLAAVGAQWIDIGEIERGLAPLRDWIAVHPREADAD
VRLRYGDLLGGARRDDALAAWLDTLRRGGAPLDAAQSARLEDQALRLVLRETDDALDRDDYEAAARALDRASPAGKADRR
YALEAAELARTQGRYDAARAALAPLLARAPDDADAQLALARILDDDGAPADALALVRDVLARTPPDDVDTQLSALRRLTA
LRRARDAAALADTLRAAYPARADVTVAAGRVAQALGRYDDAASLYRLSLAQERATGIAPRRDGATPAQAAWADLQQRRDP
QIEAGWLPAYKSGDEGVSAYRAHQMPVYLQMPYRYDGHAFVHLDAVRLDAGTLDTSDPRAYAFDTFATHPALADAAAPGG
ALRQRAAGIGGGIGYRDDAWRVDVGTTPLGFPVHYVVGGVRYRFDAGPASVTVSAARRPETGSVLSYAGLRDPWTGATWG
GVRRDSVGVRASVDIGRVNLFADLAAARLTGRNVAENAAVTLRTGFMAPVYRRADMRVSAGLVGNAWHYAQNLRYYTYGQ
GGYYSPQRYLSIGMPLEWAGRRGAFTWDVTATVGVSNSYERDSPYFPNGLPGSTLVKSAPALGNPVFSRGSTRGVSFWYG
FAGVAEYRVNGRLAVGARFDIDHAHDYAPSAGLLYVRYAFDARKDSGGFSPSPVRLYSSY

Sequences:

>Translated_1500_residues
MTAGPQTRRRARRGAGCAGIAAVAAIAFAVPCFASAAADDVAARWAASERSLADAHACAGVRSAAPGWAVSMEAAAPPPR
FVPPGPNTSPGAMQANVEAMSPAAPARAGAMVRASSARLEPAPSASVDASSANVEAMPPAAPAQAAAMTQASPVRPASVP
RASFDAPSAQAGSMPPDTAHRHASAASSLARTTAPALPFAPAGFASAALRAFAPTYPMSLMSPTSPKQTPPVRFVPTSPR
GAPATPQPVATPHAPDADAVRALYATARMWANKHRDDLARDALRKALLIAPRDPALLAEHTRILLRVGDAKGARASLERL
KQAAPGALATRQVDDEYRVATSGREEMAQIRLLARSGRGDEAARRIVALFPHGAPAGSLGAEYYQIVASAPDGRARAIDA
LRRAVAADPADADAATVLAKLLNQRDDTRAQANRLAWALVARPDTDRRASLALWRSVLQSAGRDLAYLDALRAYLTFAPE
DDEFRGNAAALEQQRDARLRLARDPDYIAQQRGLQALARGDPAAAEPLLARAAAARAGDPDALGGLGLLRLRQGRHDEAR
ALFVRAAALAPDNRAKWVGLAGTARFWGTLAQGRAAAAQGRPDDAQRAARAALALDPQSADAKLLLADSLLARRDWRAAQ
PLLRALLDARAPSVSAVRSMRTLYEQTGRADAFGPLVDALQSRFAAPDDRAALSRLRAEWLAQQADALAAAGQRGPAAQR
YEASLRIAPDAPWARFALARLYRDMGLPQLGRAVMDEGLAGSDAADMRYAAALYRHALDDVAGARAAFAAIADASRTQGM
RAFARKLDAEAALADARAALAREDRAAAHAALERARRAAPDDPDMLAAVGAQWIDIGEIERGLAPLRDWIAVHPREADAD
VRLRYGDLLGGARRDDALAAWLDTLRRGGAPLDAAQSARLEDQALRLVLRETDDALDRDDYEAAARALDRASPAGKADRR
YALEAAELARTQGRYDAARAALAPLLARAPDDADAQLALARILDDDGAPADALALVRDVLARTPPDDVDTQLSALRRLTA
LRRARDAAALADTLRAAYPARADVTVAAGRVAQALGRYDDAASLYRLSLAQERATGIAPRRDGATPAQAAWADLQQRRDP
QIEAGWLPAYKSGDEGVSAYRAHQMPVYLQMPYRYDGHAFVHLDAVRLDAGTLDTSDPRAYAFDTFATHPALADAAAPGG
ALRQRAAGIGGGIGYRDDAWRVDVGTTPLGFPVHYVVGGVRYRFDAGPASVTVSAARRPETGSVLSYAGLRDPWTGATWG
GVRRDSVGVRASVDIGRVNLFADLAAARLTGRNVAENAAVTLRTGFMAPVYRRADMRVSAGLVGNAWHYAQNLRYYTYGQ
GGYYSPQRYLSIGMPLEWAGRRGAFTWDVTATVGVSNSYERDSPYFPNGLPGSTLVKSAPALGNPVFSRGSTRGVSFWYG
FAGVAEYRVNGRLAVGARFDIDHAHDYAPSAGLLYVRYAFDARKDSGGFSPSPVRLYSSY
>Mature_1499_residues
TAGPQTRRRARRGAGCAGIAAVAAIAFAVPCFASAAADDVAARWAASERSLADAHACAGVRSAAPGWAVSMEAAAPPPRF
VPPGPNTSPGAMQANVEAMSPAAPARAGAMVRASSARLEPAPSASVDASSANVEAMPPAAPAQAAAMTQASPVRPASVPR
ASFDAPSAQAGSMPPDTAHRHASAASSLARTTAPALPFAPAGFASAALRAFAPTYPMSLMSPTSPKQTPPVRFVPTSPRG
APATPQPVATPHAPDADAVRALYATARMWANKHRDDLARDALRKALLIAPRDPALLAEHTRILLRVGDAKGARASLERLK
QAAPGALATRQVDDEYRVATSGREEMAQIRLLARSGRGDEAARRIVALFPHGAPAGSLGAEYYQIVASAPDGRARAIDAL
RRAVAADPADADAATVLAKLLNQRDDTRAQANRLAWALVARPDTDRRASLALWRSVLQSAGRDLAYLDALRAYLTFAPED
DEFRGNAAALEQQRDARLRLARDPDYIAQQRGLQALARGDPAAAEPLLARAAAARAGDPDALGGLGLLRLRQGRHDEARA
LFVRAAALAPDNRAKWVGLAGTARFWGTLAQGRAAAAQGRPDDAQRAARAALALDPQSADAKLLLADSLLARRDWRAAQP
LLRALLDARAPSVSAVRSMRTLYEQTGRADAFGPLVDALQSRFAAPDDRAALSRLRAEWLAQQADALAAAGQRGPAAQRY
EASLRIAPDAPWARFALARLYRDMGLPQLGRAVMDEGLAGSDAADMRYAAALYRHALDDVAGARAAFAAIADASRTQGMR
AFARKLDAEAALADARAALAREDRAAAHAALERARRAAPDDPDMLAAVGAQWIDIGEIERGLAPLRDWIAVHPREADADV
RLRYGDLLGGARRDDALAAWLDTLRRGGAPLDAAQSARLEDQALRLVLRETDDALDRDDYEAAARALDRASPAGKADRRY
ALEAAELARTQGRYDAARAALAPLLARAPDDADAQLALARILDDDGAPADALALVRDVLARTPPDDVDTQLSALRRLTAL
RRARDAAALADTLRAAYPARADVTVAAGRVAQALGRYDDAASLYRLSLAQERATGIAPRRDGATPAQAAWADLQQRRDPQ
IEAGWLPAYKSGDEGVSAYRAHQMPVYLQMPYRYDGHAFVHLDAVRLDAGTLDTSDPRAYAFDTFATHPALADAAAPGGA
LRQRAAGIGGGIGYRDDAWRVDVGTTPLGFPVHYVVGGVRYRFDAGPASVTVSAARRPETGSVLSYAGLRDPWTGATWGG
VRRDSVGVRASVDIGRVNLFADLAAARLTGRNVAENAAVTLRTGFMAPVYRRADMRVSAGLVGNAWHYAQNLRYYTYGQG
GYYSPQRYLSIGMPLEWAGRRGAFTWDVTATVGVSNSYERDSPYFPNGLPGSTLVKSAPALGNPVFSRGSTRGVSFWYGF
AGVAEYRVNGRLAVGARFDIDHAHDYAPSAGLLYVRYAFDARKDSGGFSPSPVRLYSSY

Specific function: Required for maximal bacterial cellulose synthesis [H]

COG id: COG0457

COG function: function code R; FOG: TPR repeat

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 9 TPR repeats [H]

Homologues:

Organism=Escherichia coli, GI226510983, Length=778, Percent_Identity=31.6195372750643, Blast_Score=246, Evalue=7e-66,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR008410
- InterPro:   IPR013026
- InterPro:   IPR011990
- InterPro:   IPR013105
- InterPro:   IPR019734 [H]

Pfam domain/function: PF05420 BCSC_C; PF07719 TPR_2 [H]

EC number: NA

Molecular weight: Translated: 158985; Mature: 158854

Theoretical pI: Translated: 9.94; Mature: 9.94

Prosite motif: PS50005 TPR L=RR ; PS50293 TPR_REGION L=RR

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.2 %Cys     (Translated Protein)
1.5 %Met     (Translated Protein)
1.7 %Cys+Met (Translated Protein)
0.2 %Cys     (Mature Protein)
1.5 %Met     (Mature Protein)
1.7 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MTAGPQTRRRARRGAGCAGIAAVAAIAFAVPCFASAAADDVAARWAASERSLADAHACAG
CCCCHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHC
VRSAAPGWAVSMEAAAPPPRFVPPGPNTSPGAMQANVEAMSPAAPARAGAMVRASSARLE
HHCCCCCCEEEECCCCCCCCCCCCCCCCCCCCEECCHHHCCCCCCHHHCCEEEECCCCCC
PAPSASVDASSANVEAMPPAAPAQAAAMTQASPVRPASVPRASFDAPSAQAGSMPPDTAH
CCCCCCCCCCCCCCCCCCCCCCHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHH
RHASAASSLARTTAPALPFAPAGFASAALRAFAPTYPMSLMSPTSPKQTPPVRFVPTSPR
HHHHHHHHHHHHHCCCCCCCCCCHHHHHHHHHCCCCCHHHCCCCCCCCCCCEEEEECCCC
GAPATPQPVATPHAPDADAVRALYATARMWANKHRDDLARDALRKALLIAPRDPALLAEH
CCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHEEECCCCCHHHHHC
TRILLRVGDAKGARASLERLKQAAPGALATRQVDDEYRVATSGREEMAQIRLLARSGRGD
CEEEEEECCCCCHHHHHHHHHHHCCCCHHHCCCCCCHHHHCCCHHHHHHHHHHHHCCCCH
EAARRIVALFPHGAPAGSLGAEYYQIVASAPDGRARAIDALRRAVAADPADADAATVLAK
HHHHHEEEECCCCCCCCCCCHHHHHHHHCCCCCHHHHHHHHHHHHHCCCCCCHHHHHHHH
LLNQRDDTRAQANRLAWALVARPDTDRRASLALWRSVLQSAGRDLAYLDALRAYLTFAPE
HHCCCCHHHHHHHHEEEEEEECCCCCHHHHHHHHHHHHHHCCCCHHHHHHHHHHHCCCCC
DDEFRGNAAALEQQRDARLRLARDPDYIAQQRGLQALARGDPAAAEPLLARAAAARAGDP
CCCCCCCHHHHHHHHCCCEEECCCCHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHCCCCC
DALGGLGLLRLRQGRHDEARALFVRAAALAPDNRAKWVGLAGTARFWGTLAQGRAAAAQG
HHHCCHHHHHHHCCCCHHHHHHHHHHHHCCCCCCCCEEECCCHHHHHHHHHHCCHHHCCC
RPDDAQRAARAALALDPQSADAKLLLADSLLARRDWRAAQPLLRALLDARAPSVSAVRSM
CCCHHHHHHHHHHEECCCCCCCEEEHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHH
RTLYEQTGRADAFGPLVDALQSRFAAPDDRAALSRLRAEWLAQQADALAAAGQRGPAAQR
HHHHHHHCCCCHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCHH
YEASLRIAPDAPWARFALARLYRDMGLPQLGRAVMDEGLAGSDAADMRYAAALYRHALDD
HCCEEEECCCCCHHHHHHHHHHHHCCCHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHH
VAGARAAFAAIADASRTQGMRAFARKLDAEAALADARAALAREDRAAAHAALERARRAAP
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCC
DDPDMLAAVGAQWIDIGEIERGLAPLRDWIAVHPREADADVRLRYGDLLGGARRDDALAA
CCHHHHHHHCCHHCCHHHHHHHHHHHHHHHEECCCCCCCCEEEEEHHHCCCCCCHHHHHH
WLDTLRRGGAPLDAAQSARLEDQALRLVLRETDDALDRDDYEAAARALDRASPAGKADRR
HHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHCCCCCCCHHH
YALEAAELARTQGRYDAARAALAPLLARAPDDADAQLALARILDDDGAPADALALVRDVL
HHHHHHHHHHHCCHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHCCCCCCHHHHHHHHHHH
ARTPPDDVDTQLSALRRLTALRRARDAAALADTLRAAYPARADVTVAAGRVAQALGRYDD
HCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCEEHHHHHHHHHHHCCCC
AASLYRLSLAQERATGIAPRRDGATPAQAAWADLQQRRDPQIEAGWLPAYKSGDEGVSAY
HHHHHHHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCHHHH
RAHQMPVYLQMPYRYDGHAFVHLDAVRLDAGTLDTSDPRAYAFDTFATHPALADAAAPGG
HHCCCCEEEECCEEECCEEEEEEEEEEECCCCCCCCCCCEEEEHHHHCCCHHHHHCCCCH
ALRQRAAGIGGGIGYRDDAWRVDVGTTPLGFPVHYVVGGVRYRFDAGPASVTVSAARRPE
HHHHHHHCCCCCCCCCCCCEEEECCCCCCCCHHHHHHCCEEEEECCCCCEEEEEECCCCC
TGSVLSYAGLRDPWTGATWGGVRRDSVGVRASVDIGRVNLFADLAAARLTGRNVAENAAV
CCCEEEECCCCCCCCCCCCCCCCCCCCCCEEECCCCHHHHHHHHHHHHHCCCCHHCCCEE
TLRTGFMAPVYRRADMRVSAGLVGNAWHYAQNLRYYTYGQGGYYSPQRYLSIGMPLEWAG
EEECCCCCHHHHHCCCEEECCCCCCHHHHHHCCEEEEECCCCCCCCHHHEEECCCHHCCC
RRGAFTWDVTATVGVSNSYERDSPYFPNGLPGSTLVKSAPALGNPVFSRGSTRGVSFWYG
CCCCEEEEEEEEEECCCCCCCCCCCCCCCCCCHHHHHCCCCCCCCHHCCCCCCCEEEEEH
FAGVAEYRVNGRLAVGARFDIDHAHDYAPSAGLLYVRYAFDARKDSGGFSPSPVRLYSSY
HHHHEEEEECCEEEEEEEECCCCCCCCCCCCCEEEEEEEECCCCCCCCCCCCCEEEECCC
>Mature Secondary Structure 
TAGPQTRRRARRGAGCAGIAAVAAIAFAVPCFASAAADDVAARWAASERSLADAHACAG
CCCHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHC
VRSAAPGWAVSMEAAAPPPRFVPPGPNTSPGAMQANVEAMSPAAPARAGAMVRASSARLE
HHCCCCCCEEEECCCCCCCCCCCCCCCCCCCCEECCHHHCCCCCCHHHCCEEEECCCCCC
PAPSASVDASSANVEAMPPAAPAQAAAMTQASPVRPASVPRASFDAPSAQAGSMPPDTAH
CCCCCCCCCCCCCCCCCCCCCCHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHH
RHASAASSLARTTAPALPFAPAGFASAALRAFAPTYPMSLMSPTSPKQTPPVRFVPTSPR
HHHHHHHHHHHHHCCCCCCCCCCHHHHHHHHHCCCCCHHHCCCCCCCCCCCEEEEECCCC
GAPATPQPVATPHAPDADAVRALYATARMWANKHRDDLARDALRKALLIAPRDPALLAEH
CCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHEEECCCCCHHHHHC
TRILLRVGDAKGARASLERLKQAAPGALATRQVDDEYRVATSGREEMAQIRLLARSGRGD
CEEEEEECCCCCHHHHHHHHHHHCCCCHHHCCCCCCHHHHCCCHHHHHHHHHHHHCCCCH
EAARRIVALFPHGAPAGSLGAEYYQIVASAPDGRARAIDALRRAVAADPADADAATVLAK
HHHHHEEEECCCCCCCCCCCHHHHHHHHCCCCCHHHHHHHHHHHHHCCCCCCHHHHHHHH
LLNQRDDTRAQANRLAWALVARPDTDRRASLALWRSVLQSAGRDLAYLDALRAYLTFAPE
HHCCCCHHHHHHHHEEEEEEECCCCCHHHHHHHHHHHHHHCCCCHHHHHHHHHHHCCCCC
DDEFRGNAAALEQQRDARLRLARDPDYIAQQRGLQALARGDPAAAEPLLARAAAARAGDP
CCCCCCCHHHHHHHHCCCEEECCCCHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHCCCCC
DALGGLGLLRLRQGRHDEARALFVRAAALAPDNRAKWVGLAGTARFWGTLAQGRAAAAQG
HHHCCHHHHHHHCCCCHHHHHHHHHHHHCCCCCCCCEEECCCHHHHHHHHHHCCHHHCCC
RPDDAQRAARAALALDPQSADAKLLLADSLLARRDWRAAQPLLRALLDARAPSVSAVRSM
CCCHHHHHHHHHHEECCCCCCCEEEHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHH
RTLYEQTGRADAFGPLVDALQSRFAAPDDRAALSRLRAEWLAQQADALAAAGQRGPAAQR
HHHHHHHCCCCHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCHH
YEASLRIAPDAPWARFALARLYRDMGLPQLGRAVMDEGLAGSDAADMRYAAALYRHALDD
HCCEEEECCCCCHHHHHHHHHHHHCCCHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHH
VAGARAAFAAIADASRTQGMRAFARKLDAEAALADARAALAREDRAAAHAALERARRAAP
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCC
DDPDMLAAVGAQWIDIGEIERGLAPLRDWIAVHPREADADVRLRYGDLLGGARRDDALAA
CCHHHHHHHCCHHCCHHHHHHHHHHHHHHHEECCCCCCCCEEEEEHHHCCCCCCHHHHHH
WLDTLRRGGAPLDAAQSARLEDQALRLVLRETDDALDRDDYEAAARALDRASPAGKADRR
HHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHCCCCCCCHHH
YALEAAELARTQGRYDAARAALAPLLARAPDDADAQLALARILDDDGAPADALALVRDVL
HHHHHHHHHHHCCHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHCCCCCCHHHHHHHHHHH
ARTPPDDVDTQLSALRRLTALRRARDAAALADTLRAAYPARADVTVAAGRVAQALGRYDD
HCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCEEHHHHHHHHHHHCCCC
AASLYRLSLAQERATGIAPRRDGATPAQAAWADLQQRRDPQIEAGWLPAYKSGDEGVSAY
HHHHHHHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCHHHH
RAHQMPVYLQMPYRYDGHAFVHLDAVRLDAGTLDTSDPRAYAFDTFATHPALADAAAPGG
HHCCCCEEEECCEEECCEEEEEEEEEEECCCCCCCCCCCEEEEHHHHCCCHHHHHCCCCH
ALRQRAAGIGGGIGYRDDAWRVDVGTTPLGFPVHYVVGGVRYRFDAGPASVTVSAARRPE
HHHHHHHCCCCCCCCCCCCEEEECCCCCCCCHHHHHHCCEEEEECCCCCEEEEEECCCCC
TGSVLSYAGLRDPWTGATWGGVRRDSVGVRASVDIGRVNLFADLAAARLTGRNVAENAAV
CCCEEEECCCCCCCCCCCCCCCCCCCCCCEEECCCCHHHHHHHHHHHHHCCCCHHCCCEE
TLRTGFMAPVYRRADMRVSAGLVGNAWHYAQNLRYYTYGQGGYYSPQRYLSIGMPLEWAG
EEECCCCCHHHHHCCCEEECCCCCCHHHHHHCCEEEEECCCCCCCCHHHEEECCCHHCCC
RRGAFTWDVTATVGVSNSYERDSPYFPNGLPGSTLVKSAPALGNPVFSRGSTRGVSFWYG
CCCCEEEEEEEEEECCCCCCCCCCCCCCCCCCHHHHHCCCCCCCCHHCCCCCCCEEEEEH
FAGVAEYRVNGRLAVGARFDIDHAHDYAPSAGLLYVRYAFDARKDSGGFSPSPVRLYSSY
HHHHEEEEECCEEEEEEEECCCCCCCCCCCCCEEEEEEEECCCCCCCCCCCCCEEEECCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 8041620; 9278503; 11260463 [H]