The gene/protein map for NC_009972 is currently unavailable.
Definition Herpetosiphon aurantiacus ATCC 23779 chromosome, complete genome.
Accession NC_009972
Length 6,346,587

Click here to switch to the map view.

The map label for this gene is 159896723

Identifier: 159896723

GI number: 159896723

Start: 218069

End: 222409

Strand: Direct

Name: 159896723

Synonym: Haur_0190

Alternate gene names: NA

Gene position: 218069-222409 (Clockwise)

Preceding gene: 159896722

Following gene: 159896724

Centisome position: 3.44

GC content: 57.57

Gene sequence:

>4341_bases
ATGAATTGTCCTCGCTGTGGCACGCCCAATACTCCTGATCGCCAATTTTGTGGGCAATGTCAAGCGCCATTGGCTGTAAC
GCCAAGCGCTAGCAATGATCTACCACCATGGTTGCAAGATCTCGATCAGCAACAAACAGTTGTGCCTGCTAAACGTGGCA
CATCGAGCCTACCACCGTGGTTGCAAGAAGCAAGCCCACCGCCGCCAGTTGCTGCGAATGCCGAGAGCTTGCCGCCTTGG
TTACAAGAATCGGCAGCGCCAATCCCCGCGCCGAATGTTGCACCAGCACCCGCCAATAGCGAAGAGCTTCCACCATGGCT
CCGTGATTTGCAAGCAACTGCTCCTGCCTTGCCTGCTGACGAACCATTGCCAAATGCTCCACGCTCCGAACAACCCTTGC
CTAATTGGTTATCCGATTTGCAGTCAGGTTCAACTCCGCCGCCACCCACACCAGTGGTCAACGCTGATGTGCCGTCGTGG
TTGCAAGGCTCGGTCGAGACAACCCCACCAGCGCCTAAGCCCAGTGCCAACGCTGATGTGCCATCGTGGTTGCAAGAGCC
AGCGTTGCCCGCCGCTCCCGCCCCAACGCCAGTAGCGCCAAGCGCTGATGTGCCGTCGTGGTTGCAAGGCTCGGTCGAGA
CCGCCCCACCAGCGCCTAAGCCCAGTGCCAACGCCGATGTGCCATCGTGGTTGCAAGAGCCAGCGTTGCCCGCCGCTCCT
GCCCCAACGCCAGTAGCGCCAAGCGCTGATGTGCCGTCGTGGTTGCAAGAACCAGCATTGCCCGCCGACCCTGCCCCAAC
ACCAGCAGCACCAAGTGCTGATGTGCCGTCGTGGTTGCAAGGCTCGGTCGAGACGACCCCACCAGCTCCCAAGCCCAGTG
CCAACGCCGATGAAGAGCCTATGCCAGCATGGTTGCAGCAGTTGCGACCGAGTGAACCAGCACCACCACCAGGTATTGCC
TCGTTTGTGGAAGATAATGAAGAACCTGTGATTGCGCGACGTGGTGGGACTGGCAATTTGCCCGATTGGCTCAAAGATTT
CGATACCGAGCCACCTGTGGTGCAATTATCAGATGTCGATCTCGATGCAGCTGGGCCAAGCGATGATGTGCCACCTTGGC
TCAAGCCTGCAACAGCTCCATTAACTTCGCCAGCAGCCCCAGCGGCAAGTAGCGGAGTGCCAGCGTGGATGCAAGCCGAT
TCCGCCCCACCAGCACCGCCAGCGGCTCCGGCAGCAAGCGCAGGGGATGATGTGCCGTCGTGGTTGCGCGGGGATTTAGA
TGTCGTGCCGCCAGCGGCTCCGGCAGCGAGTGGCGATGTGCCGTCGTGGTTGCAAGCTGAATCAGCACCACCAGCGGTTC
CAGCAGCAAGTGCAGGCGACGATGTGCCAGCGTGGTTGCGCGGGGATTTAGATGTCGCGCCGCCAGCGGCTCCGGCAGCG
AGTGGCGATGTGCCGTCGTGGTTGCAAGCTGAATCAGCACCACCAGCGGCTCCAGCAACAAGTGCAGGTGACGATGTGCC
AGCGTGGTTGCGCGGGGATTTAGATGTCGCGCCGCTAGTGGCTCCAGCTGTGAGTGCAGGGGATGATGTGCCAGCGTGGA
TGCAAGCCGATTCCGCCCCACTAGCCCCGCCAGCAGCAAGCACAGGCGACGATGTGCCAGCATGGTTGCGCGAGGATTTG
GATGTCGCAGCGCCAGCCGCCCCAGCAGCAAGTGGCGATGTGCCCGCGTGGATGCAAGCCGACGCAGCGCCGCCAGCCCC
GCCAGCAGCAAGCGCAGGCGACGATGTACCAGCATGGTTACGCGGGGATTTGGATGTCGCAGCTCCGCCAGCAGCTCCGG
CTGCGAGTGCAGGGGATGATGTGCCAGCGTGGTTACGCGGGGATTTAGATGTCGCGCCAGCCGCCCCAGCAGCAAGTGGC
GATGTGCCCGCGTGGATGCAAGCCGACGCAGCGCCGCCAGTCCCGCCAGCAGCAAGCGCAGGCGACGATGTGCCAGCGTG
GTTACGCGGGGATTTAGATGTCGCAGCACCGCCAGCGGCTCCGGCTGCGAGTGCAGGGGATGATGTGCCAGCGTGGTTAC
GCGGGGATTTAGATGTCGCAGCACCGCCAGCGGCTCCGGCTGTGAGTGCAGGGGATGATGTGCCAGCGTGGTTACGCGGG
GATTTAGATGTCGCAGCACCGCCAGCGGCTCCGGCTGCGAGTGCAGGGGATGATGTGCCAGCGTGGTTACGCGGGGAGTT
GGATGTCGCAGCGCCAGCAGCAAGTGGCGATGTGCCCGCATGGTTGCAAGCCGACGTAGCGCCGCCAGCCGCTCCGACTG
CAAGTGGTGGTGATATGCCTGCGTGGCTGCAAGCGGATGCAGGTGAAACTGTGCGGCTTGATTCCGCAGATGCTAGCGCT
GATGTTCCGGCATGGCTCAAAGCTGATTTAGAAGCTGCACCACCAGCAGCTCCAGCGGCGAGTGGCGATATTCCATCATG
GTTGCAAGCGGATGCAGGTGAAACTGTGCGGCTTGATTCCGCAGATGCTAGCGCTGATGTTCCGGCGTGGCTCAAAGCTG
ATTTAGAAGCTGCACCGCCAGCCGCTTCGGCAGCGAGTGGTGGCGATATTCCATCATGGCTGCAAGCGGATGCAGGTGAA
TTGCCCCAAGTTAGCCCGACTGTGCGGCTTGATCCTGAGGATTCCAGCGATAATGTTCCGGCATGGCTCAAAGCTGACTT
GGAAACGGCCTCACCAGCGGCTCCTGCGCCTATTGATACTCCCAATTGGTTGCATGAAGATGCTCCAACGGTAAAACTCG
ACAATCAAGCTGCCGGTATTCCTGCATGGTTACAAGAAGATCTGCCAACCGTTAAATTGGATAGCCCTGCAGGGAATATT
CCGGCTTGGCTACAAGATGATGTAACGCCGATTGCGCCAGCTCCAGTCAAACCTGAGCCTGTTGCGCCTGCGACTCCAAG
CTACGATCCAGAGGGTGCAAATGTCCCGGCATGGTTGCGAGACGACTTAGATATTGAGATTCCAGCGAGCAAGCCCACCG
TAGCCCCAATTATTCCGAGCAGTACCTCGCCTTCATGGCTATTGGATGATGAGCCAACCCAAGCGACTCAAGATGATACC
TTGTTGGGTAGCGTTGATTTGCCTGCGTGGTTACGCCAAACGGTTAAGTTAGAGGAACCCAGCCTAGTTGTTGAACAAGA
AGCTGCTTCGGCTGTGGCTGAATCAGCCGATTGGTTACGGGTGTTGGGTGAGCCAGAACCTGCGATTGCCGCAACCAGCC
CAACCACTCGCCGTTTGATTGATAGTGAACCGCCAGCCTTGCTTAGCCGAACGCCCGAGCGGGTTTCGGCAATGCATTTG
TTGCAAGATTTGGTGACCAAGCCGTTACCTGAGCCAGTCGAAGCACCACCTGTAGCGCTTGCGCCTTGGTGGCAGCGCAT
TGGCACTCAGCGGATTGTCGCCAGTTTGATGATTATAAGTTTGCTGGTTGGCTTGCTTGTGCCCAATCTCTTGGCGATCA
ATACTCAAGCTTTAACCATTGGCGGCAATACCAGTGATCTCTACAACTATGTGGAAACACTCAACCCCGAAAGCCGCGTG
CTGATTGCCTACGAAGGTGATTTACGCCATAACGCTGAGCTTGGGCCGTTGGAACACGCAATTTCCCAACATCTGATCGA
GCGTAAAGTGCCGATGTTATTGCTTTCGACTGATACTGAAGGGAGTTTGCTGGCAAGCCAACGTGCTGCCCAATTTCCAG
TGATCGATGCTAACACAGGCTATACTGGCGAAGGTGCTGAATACTTGAATCTTGGTTGGGTCAAAGGCAATGAACTTGGA
ATTGCCCAACTTGGCAGTAATTTGCGTGGCGCAATTGCCAACCTTTTGCTCAATCGCGAAGGTGCTGATGTTAATTTGTT
GCGAATTATGTCGAAATTGAATTCCAACAATCAGCTTGATCGCCCACGGATTACCACGACCAAAGACCTTGATTTGTTGA
TTGTGGTTGCTGATGAGCCAGGCGATGTCCAGCGCTGGATGGAGCAATTCTGGGCGCGTGAACCAGCCCTGCCAGTTGCC
ATTTTAACCACCAATGAAGTCTTACCCCAAATCCAACCCTATGTTGATGTTAATGTTAACGGCACGCCCGCCGCAATTTA
TACGGCAGCAGGCTTGGTTGGCGAACAACAATATATGGCTTTACGTTCGAATAACACCAATACTAATACCAATGGCCCGA
TCACAGCCCTGAGTTTAGGGATGATCACCACGGTTGTGGTGGTGTTAGTCGGTGGGTTGCTTCAGTTGCAACGGCGTATC
CGTGGAAAGAGGAATAGCTAG

Upstream 100 bases:

>100_bases
CGGTCTCATTTTTGGCTCGGCGATTGGTGCTATTGTTGCAAGTATTCGCATCTTACTCGGGATTGATCTCCCGTATTTGG
ATCGCTAGGAGGCGGCCTCA

Downstream 100 bases:

>100_bases
TGACAACGCTTGGCCCTTGGATCGCCTTTGGCTTGACCTTAATTGTGCTCAGCCGTGCGTTTGGCGAAAATCCACTATTT
CGATTCAGCCAATATTTGTT

Product: hypothetical protein

Products: NA

Alternate protein names: None

Number of amino acids: Translated: 1446; Mature: 1446

Protein sequence:

>1446_residues
MNCPRCGTPNTPDRQFCGQCQAPLAVTPSASNDLPPWLQDLDQQQTVVPAKRGTSSLPPWLQEASPPPPVAANAESLPPW
LQESAAPIPAPNVAPAPANSEELPPWLRDLQATAPALPADEPLPNAPRSEQPLPNWLSDLQSGSTPPPPTPVVNADVPSW
LQGSVETTPPAPKPSANADVPSWLQEPALPAAPAPTPVAPSADVPSWLQGSVETAPPAPKPSANADVPSWLQEPALPAAP
APTPVAPSADVPSWLQEPALPADPAPTPAAPSADVPSWLQGSVETTPPAPKPSANADEEPMPAWLQQLRPSEPAPPPGIA
SFVEDNEEPVIARRGGTGNLPDWLKDFDTEPPVVQLSDVDLDAAGPSDDVPPWLKPATAPLTSPAAPAASSGVPAWMQAD
SAPPAPPAAPAASAGDDVPSWLRGDLDVVPPAAPAASGDVPSWLQAESAPPAVPAASAGDDVPAWLRGDLDVAPPAAPAA
SGDVPSWLQAESAPPAAPATSAGDDVPAWLRGDLDVAPLVAPAVSAGDDVPAWMQADSAPLAPPAASTGDDVPAWLREDL
DVAAPAAPAASGDVPAWMQADAAPPAPPAASAGDDVPAWLRGDLDVAAPPAAPAASAGDDVPAWLRGDLDVAPAAPAASG
DVPAWMQADAAPPVPPAASAGDDVPAWLRGDLDVAAPPAAPAASAGDDVPAWLRGDLDVAAPPAAPAVSAGDDVPAWLRG
DLDVAAPPAAPAASAGDDVPAWLRGELDVAAPAASGDVPAWLQADVAPPAAPTASGGDMPAWLQADAGETVRLDSADASA
DVPAWLKADLEAAPPAAPAASGDIPSWLQADAGETVRLDSADASADVPAWLKADLEAAPPAASAASGGDIPSWLQADAGE
LPQVSPTVRLDPEDSSDNVPAWLKADLETASPAAPAPIDTPNWLHEDAPTVKLDNQAAGIPAWLQEDLPTVKLDSPAGNI
PAWLQDDVTPIAPAPVKPEPVAPATPSYDPEGANVPAWLRDDLDIEIPASKPTVAPIIPSSTSPSWLLDDEPTQATQDDT
LLGSVDLPAWLRQTVKLEEPSLVVEQEAASAVAESADWLRVLGEPEPAIAATSPTTRRLIDSEPPALLSRTPERVSAMHL
LQDLVTKPLPEPVEAPPVALAPWWQRIGTQRIVASLMIISLLVGLLVPNLLAINTQALTIGGNTSDLYNYVETLNPESRV
LIAYEGDLRHNAELGPLEHAISQHLIERKVPMLLLSTDTEGSLLASQRAAQFPVIDANTGYTGEGAEYLNLGWVKGNELG
IAQLGSNLRGAIANLLLNREGADVNLLRIMSKLNSNNQLDRPRITTTKDLDLLIVVADEPGDVQRWMEQFWAREPALPVA
ILTTNEVLPQIQPYVDVNVNGTPAAIYTAAGLVGEQQYMALRSNNTNTNTNGPITALSLGMITTVVVVLVGGLLQLQRRI
RGKRNS

Sequences:

>Translated_1446_residues
MNCPRCGTPNTPDRQFCGQCQAPLAVTPSASNDLPPWLQDLDQQQTVVPAKRGTSSLPPWLQEASPPPPVAANAESLPPW
LQESAAPIPAPNVAPAPANSEELPPWLRDLQATAPALPADEPLPNAPRSEQPLPNWLSDLQSGSTPPPPTPVVNADVPSW
LQGSVETTPPAPKPSANADVPSWLQEPALPAAPAPTPVAPSADVPSWLQGSVETAPPAPKPSANADVPSWLQEPALPAAP
APTPVAPSADVPSWLQEPALPADPAPTPAAPSADVPSWLQGSVETTPPAPKPSANADEEPMPAWLQQLRPSEPAPPPGIA
SFVEDNEEPVIARRGGTGNLPDWLKDFDTEPPVVQLSDVDLDAAGPSDDVPPWLKPATAPLTSPAAPAASSGVPAWMQAD
SAPPAPPAAPAASAGDDVPSWLRGDLDVVPPAAPAASGDVPSWLQAESAPPAVPAASAGDDVPAWLRGDLDVAPPAAPAA
SGDVPSWLQAESAPPAAPATSAGDDVPAWLRGDLDVAPLVAPAVSAGDDVPAWMQADSAPLAPPAASTGDDVPAWLREDL
DVAAPAAPAASGDVPAWMQADAAPPAPPAASAGDDVPAWLRGDLDVAAPPAAPAASAGDDVPAWLRGDLDVAPAAPAASG
DVPAWMQADAAPPVPPAASAGDDVPAWLRGDLDVAAPPAAPAASAGDDVPAWLRGDLDVAAPPAAPAVSAGDDVPAWLRG
DLDVAAPPAAPAASAGDDVPAWLRGELDVAAPAASGDVPAWLQADVAPPAAPTASGGDMPAWLQADAGETVRLDSADASA
DVPAWLKADLEAAPPAAPAASGDIPSWLQADAGETVRLDSADASADVPAWLKADLEAAPPAASAASGGDIPSWLQADAGE
LPQVSPTVRLDPEDSSDNVPAWLKADLETASPAAPAPIDTPNWLHEDAPTVKLDNQAAGIPAWLQEDLPTVKLDSPAGNI
PAWLQDDVTPIAPAPVKPEPVAPATPSYDPEGANVPAWLRDDLDIEIPASKPTVAPIIPSSTSPSWLLDDEPTQATQDDT
LLGSVDLPAWLRQTVKLEEPSLVVEQEAASAVAESADWLRVLGEPEPAIAATSPTTRRLIDSEPPALLSRTPERVSAMHL
LQDLVTKPLPEPVEAPPVALAPWWQRIGTQRIVASLMIISLLVGLLVPNLLAINTQALTIGGNTSDLYNYVETLNPESRV
LIAYEGDLRHNAELGPLEHAISQHLIERKVPMLLLSTDTEGSLLASQRAAQFPVIDANTGYTGEGAEYLNLGWVKGNELG
IAQLGSNLRGAIANLLLNREGADVNLLRIMSKLNSNNQLDRPRITTTKDLDLLIVVADEPGDVQRWMEQFWAREPALPVA
ILTTNEVLPQIQPYVDVNVNGTPAAIYTAAGLVGEQQYMALRSNNTNTNTNGPITALSLGMITTVVVVLVGGLLQLQRRI
RGKRNS
>Mature_1446_residues
MNCPRCGTPNTPDRQFCGQCQAPLAVTPSASNDLPPWLQDLDQQQTVVPAKRGTSSLPPWLQEASPPPPVAANAESLPPW
LQESAAPIPAPNVAPAPANSEELPPWLRDLQATAPALPADEPLPNAPRSEQPLPNWLSDLQSGSTPPPPTPVVNADVPSW
LQGSVETTPPAPKPSANADVPSWLQEPALPAAPAPTPVAPSADVPSWLQGSVETAPPAPKPSANADVPSWLQEPALPAAP
APTPVAPSADVPSWLQEPALPADPAPTPAAPSADVPSWLQGSVETTPPAPKPSANADEEPMPAWLQQLRPSEPAPPPGIA
SFVEDNEEPVIARRGGTGNLPDWLKDFDTEPPVVQLSDVDLDAAGPSDDVPPWLKPATAPLTSPAAPAASSGVPAWMQAD
SAPPAPPAAPAASAGDDVPSWLRGDLDVVPPAAPAASGDVPSWLQAESAPPAVPAASAGDDVPAWLRGDLDVAPPAAPAA
SGDVPSWLQAESAPPAAPATSAGDDVPAWLRGDLDVAPLVAPAVSAGDDVPAWMQADSAPLAPPAASTGDDVPAWLREDL
DVAAPAAPAASGDVPAWMQADAAPPAPPAASAGDDVPAWLRGDLDVAAPPAAPAASAGDDVPAWLRGDLDVAPAAPAASG
DVPAWMQADAAPPVPPAASAGDDVPAWLRGDLDVAAPPAAPAASAGDDVPAWLRGDLDVAAPPAAPAVSAGDDVPAWLRG
DLDVAAPPAAPAASAGDDVPAWLRGELDVAAPAASGDVPAWLQADVAPPAAPTASGGDMPAWLQADAGETVRLDSADASA
DVPAWLKADLEAAPPAAPAASGDIPSWLQADAGETVRLDSADASADVPAWLKADLEAAPPAASAASGGDIPSWLQADAGE
LPQVSPTVRLDPEDSSDNVPAWLKADLETASPAAPAPIDTPNWLHEDAPTVKLDNQAAGIPAWLQEDLPTVKLDSPAGNI
PAWLQDDVTPIAPAPVKPEPVAPATPSYDPEGANVPAWLRDDLDIEIPASKPTVAPIIPSSTSPSWLLDDEPTQATQDDT
LLGSVDLPAWLRQTVKLEEPSLVVEQEAASAVAESADWLRVLGEPEPAIAATSPTTRRLIDSEPPALLSRTPERVSAMHL
LQDLVTKPLPEPVEAPPVALAPWWQRIGTQRIVASLMIISLLVGLLVPNLLAINTQALTIGGNTSDLYNYVETLNPESRV
LIAYEGDLRHNAELGPLEHAISQHLIERKVPMLLLSTDTEGSLLASQRAAQFPVIDANTGYTGEGAEYLNLGWVKGNELG
IAQLGSNLRGAIANLLLNREGADVNLLRIMSKLNSNNQLDRPRITTTKDLDLLIVVADEPGDVQRWMEQFWAREPALPVA
ILTTNEVLPQIQPYVDVNVNGTPAAIYTAAGLVGEQQYMALRSNNTNTNTNGPITALSLGMITTVVVVLVGGLLQLQRRI
RGKRNS

Specific function: Unknown

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 148939; Mature: 148939

Theoretical pI: Translated: 3.76; Mature: 3.76

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.3 %Cys     (Translated Protein)
1.0 %Met     (Translated Protein)
1.2 %Cys+Met (Translated Protein)
0.3 %Cys     (Mature Protein)
1.0 %Met     (Mature Protein)
1.2 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MNCPRCGTPNTPDRQFCGQCQAPLAVTPSASNDLPPWLQDLDQQQTVVPAKRGTSSLPPW
CCCCCCCCCCCCCHHHHHCCCCCEEECCCCCCCCCHHHHHHCCCCEECCHHCCCCCCCCH
LQEASPPPPVAANAESLPPWLQESAAPIPAPNVAPAPANSEELPPWLRDLQATAPALPAD
HHHCCCCCCCCCCCCCCCHHHHHCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHCCCCCCC
EPLPNAPRSEQPLPNWLSDLQSGSTPPPPTPVVNADVPSWLQGSVETTPPAPKPSANADV
CCCCCCCCCCCCCHHHHHHHHCCCCCCCCCCEECCCCCHHHCCCCCCCCCCCCCCCCCCC
PSWLQEPALPAAPAPTPVAPSADVPSWLQGSVETAPPAPKPSANADVPSWLQEPALPAAP
HHHHHCCCCCCCCCCCCCCCCCCCCHHHCCCCCCCCCCCCCCCCCCCHHHHHCCCCCCCC
APTPVAPSADVPSWLQEPALPADPAPTPAAPSADVPSWLQGSVETTPPAPKPSANADEEP
CCCCCCCCCCCCHHHHCCCCCCCCCCCCCCCCCCCCHHHCCCCCCCCCCCCCCCCCCCCC
MPAWLQQLRPSEPAPPPGIASFVEDNEEPVIARRGGTGNLPDWLKDFDTEPPVVQLSDVD
HHHHHHHHCCCCCCCCCCHHHHHCCCCCCEEEECCCCCCCHHHHHHCCCCCCEEEEECCC
LDAAGPSDDVPPWLKPATAPLTSPAAPAASSGVPAWMQADSAPPAPPAAPAASAGDDVPS
CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHCCCCCCCCCCCCCCCCCCCCCHH
WLRGDLDVVPPAAPAASGDVPSWLQAESAPPAVPAASAGDDVPAWLRGDLDVAPPAAPAA
HHCCCCCCCCCCCCCCCCCCCHHHHCCCCCCCCCCCCCCCCCCHHHCCCCCCCCCCCCCC
SGDVPSWLQAESAPPAAPATSAGDDVPAWLRGDLDVAPLVAPAVSAGDDVPAWMQADSAP
CCCCCHHHHCCCCCCCCCCCCCCCCCCHHHCCCCCHHHHHHHHHCCCCCCCHHHCCCCCC
LAPPAASTGDDVPAWLREDLDVAAPAAPAASGDVPAWMQADAAPPAPPAASAGDDVPAWL
CCCCCCCCCCCCHHHHHHCCCCCCCCCCCCCCCCCHHHCCCCCCCCCCCCCCCCCCCHHH
RGDLDVAAPPAAPAASAGDDVPAWLRGDLDVAPAAPAASGDVPAWMQADAAPPVPPAASA
CCCCCCCCCCCCCCCCCCCCCCHHHCCCCCCCCCCCCCCCCCCHHHCCCCCCCCCCCCCC
GDDVPAWLRGDLDVAAPPAAPAASAGDDVPAWLRGDLDVAAPPAAPAVSAGDDVPAWLRG
CCCCCHHHCCCCCCCCCCCCCCCCCCCCCCHHHCCCCCCCCCCCCCCCCCCCCCCHHHCC
DLDVAAPPAAPAASAGDDVPAWLRGELDVAAPAASGDVPAWLQADVAPPAAPTASGGDMP
CCCCCCCCCCCCCCCCCCCCHHHCCCCEEECCCCCCCCCHHHCCCCCCCCCCCCCCCCCC
AWLQADAGETVRLDSADASADVPAWLKADLEAAPPAAPAASGDIPSWLQADAGETVRLDS
EEEECCCCCEEEECCCCCCCCCCHHHHHCCCCCCCCCCCCCCCCCHHHHCCCCCEEEECC
ADASADVPAWLKADLEAAPPAASAASGGDIPSWLQADAGELPQVSPTVRLDPEDSSDNVP
CCCCCCCCHHHHHCCCCCCCCCCCCCCCCCHHHHHCCCCCCCCCCCCEEECCCCCCCCCC
AWLKADLETASPAAPAPIDTPNWLHEDAPTVKLDNQAAGIPAWLQEDLPTVKLDSPAGNI
CEEEECCCCCCCCCCCCCCCCCCCCCCCCEEEECCCCCCCCHHHHHCCCEEEECCCCCCC
PAWLQDDVTPIAPAPVKPEPVAPATPSYDPEGANVPAWLRDDLDIEIPASKPTVAPIIPS
CHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHCCCCCCEEECCCCCCEEEECCC
STSPSWLLDDEPTQATQDDTLLGSVDLPAWLRQTVKLEEPSLVVEQEAASAVAESADWLR
CCCCCEEECCCCCCCCCCCCEEECCCCCHHHHHHHCCCCCCEEEHHHHHHHHHHHHHHHH
VLGEPEPAIAATSPTTRRLIDSEPPALLSRTPERVSAMHLLQDLVTKPLPEPVEAPPVAL
HHCCCCCCEEECCCHHHHHHCCCCCHHHHCCHHHHHHHHHHHHHHHCCCCCCCCCCCCEE
APWWQRIGTQRIVASLMIISLLVGLLVPNLLAINTQALTIGGNTSDLYNYVETLNPESRV
CHHHHHHHHHHHHHHHHHHHHHHHHHHHHHEEECCEEEEECCCHHHHHHHHHHCCCCCEE
LIAYEGDLRHNAELGPLEHAISQHLIERKVPMLLLSTDTEGSLLASQRAAQFPVIDANTG
EEEEECCCCCCCCCCHHHHHHHHHHHHHCCCEEEEECCCCCCHHHHHHHCCCCEEECCCC
YTGEGAEYLNLGWVKGNELGIAQLGSNLRGAIANLLLNREGADVNLLRIMSKLNSNNQLD
CCCCCCCEEEEEEECCCCCCHHHHCCHHHHHHHHHHHCCCCCCHHHHHHHHHHCCCCCCC
RPRITTTKDLDLLIVVADEPGDVQRWMEQFWAREPALPVAILTTNEVLPQIQPYVDVNVN
CCCCCCCCCCEEEEEEECCCCHHHHHHHHHHCCCCCCCEEEEECHHHHHCCCCEEEEECC
GTPAAIYTAAGLVGEQQYMALRSNNTNTNTNGPITALSLGMITTVVVVLVGGLLQLQRRI
CCCHHHHHHHHHHCCHHHEEEECCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHH
RGKRNS
CCCCCC
>Mature Secondary Structure
MNCPRCGTPNTPDRQFCGQCQAPLAVTPSASNDLPPWLQDLDQQQTVVPAKRGTSSLPPW
CCCCCCCCCCCCCHHHHHCCCCCEEECCCCCCCCCHHHHHHCCCCEECCHHCCCCCCCCH
LQEASPPPPVAANAESLPPWLQESAAPIPAPNVAPAPANSEELPPWLRDLQATAPALPAD
HHHCCCCCCCCCCCCCCCHHHHHCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHCCCCCCC
EPLPNAPRSEQPLPNWLSDLQSGSTPPPPTPVVNADVPSWLQGSVETTPPAPKPSANADV
CCCCCCCCCCCCCHHHHHHHHCCCCCCCCCCEECCCCCHHHCCCCCCCCCCCCCCCCCCC
PSWLQEPALPAAPAPTPVAPSADVPSWLQGSVETAPPAPKPSANADVPSWLQEPALPAAP
HHHHHCCCCCCCCCCCCCCCCCCCCHHHCCCCCCCCCCCCCCCCCCCHHHHHCCCCCCCC
APTPVAPSADVPSWLQEPALPADPAPTPAAPSADVPSWLQGSVETTPPAPKPSANADEEP
CCCCCCCCCCCCHHHHCCCCCCCCCCCCCCCCCCCCHHHCCCCCCCCCCCCCCCCCCCCC
MPAWLQQLRPSEPAPPPGIASFVEDNEEPVIARRGGTGNLPDWLKDFDTEPPVVQLSDVD
HHHHHHHHCCCCCCCCCCHHHHHCCCCCCEEEECCCCCCCHHHHHHCCCCCCEEEEECCC
LDAAGPSDDVPPWLKPATAPLTSPAAPAASSGVPAWMQADSAPPAPPAAPAASAGDDVPS
CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHCCCCCCCCCCCCCCCCCCCCCHH
WLRGDLDVVPPAAPAASGDVPSWLQAESAPPAVPAASAGDDVPAWLRGDLDVAPPAAPAA
HHCCCCCCCCCCCCCCCCCCCHHHHCCCCCCCCCCCCCCCCCCHHHCCCCCCCCCCCCCC
SGDVPSWLQAESAPPAAPATSAGDDVPAWLRGDLDVAPLVAPAVSAGDDVPAWMQADSAP
CCCCCHHHHCCCCCCCCCCCCCCCCCCHHHCCCCCHHHHHHHHHCCCCCCCHHHCCCCCC
LAPPAASTGDDVPAWLREDLDVAAPAAPAASGDVPAWMQADAAPPAPPAASAGDDVPAWL
CCCCCCCCCCCCHHHHHHCCCCCCCCCCCCCCCCCHHHCCCCCCCCCCCCCCCCCCCHHH
RGDLDVAAPPAAPAASAGDDVPAWLRGDLDVAPAAPAASGDVPAWMQADAAPPVPPAASA
CCCCCCCCCCCCCCCCCCCCCCHHHCCCCCCCCCCCCCCCCCCHHHCCCCCCCCCCCCCC
GDDVPAWLRGDLDVAAPPAAPAASAGDDVPAWLRGDLDVAAPPAAPAVSAGDDVPAWLRG
CCCCCHHHCCCCCCCCCCCCCCCCCCCCCCHHHCCCCCCCCCCCCCCCCCCCCCCHHHCC
DLDVAAPPAAPAASAGDDVPAWLRGELDVAAPAASGDVPAWLQADVAPPAAPTASGGDMP
CCCCCCCCCCCCCCCCCCCCHHHCCCCEEECCCCCCCCCHHHCCCCCCCCCCCCCCCCCC
AWLQADAGETVRLDSADASADVPAWLKADLEAAPPAAPAASGDIPSWLQADAGETVRLDS
EEEECCCCCEEEECCCCCCCCCCHHHHHCCCCCCCCCCCCCCCCCHHHHCCCCCEEEECC
ADASADVPAWLKADLEAAPPAASAASGGDIPSWLQADAGELPQVSPTVRLDPEDSSDNVP
CCCCCCCCHHHHHCCCCCCCCCCCCCCCCCHHHHHCCCCCCCCCCCCEEECCCCCCCCCC
AWLKADLETASPAAPAPIDTPNWLHEDAPTVKLDNQAAGIPAWLQEDLPTVKLDSPAGNI
CEEEECCCCCCCCCCCCCCCCCCCCCCCCEEEECCCCCCCCHHHHHCCCEEEECCCCCCC
PAWLQDDVTPIAPAPVKPEPVAPATPSYDPEGANVPAWLRDDLDIEIPASKPTVAPIIPS
CHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHCCCCCCEEECCCCCCEEEECCC
STSPSWLLDDEPTQATQDDTLLGSVDLPAWLRQTVKLEEPSLVVEQEAASAVAESADWLR
CCCCCEEECCCCCCCCCCCCEEECCCCCHHHHHHHCCCCCCEEEHHHHHHHHHHHHHHHH
VLGEPEPAIAATSPTTRRLIDSEPPALLSRTPERVSAMHLLQDLVTKPLPEPVEAPPVAL
HHCCCCCCEEECCCHHHHHHCCCCCHHHHCCHHHHHHHHHHHHHHHCCCCCCCCCCCCEE
APWWQRIGTQRIVASLMIISLLVGLLVPNLLAINTQALTIGGNTSDLYNYVETLNPESRV
CHHHHHHHHHHHHHHHHHHHHHHHHHHHHHEEECCEEEEECCCHHHHHHHHHHCCCCCEE
LIAYEGDLRHNAELGPLEHAISQHLIERKVPMLLLSTDTEGSLLASQRAAQFPVIDANTG
EEEEECCCCCCCCCCHHHHHHHHHHHHHCCCEEEEECCCCCCHHHHHHHCCCCEEECCCC
YTGEGAEYLNLGWVKGNELGIAQLGSNLRGAIANLLLNREGADVNLLRIMSKLNSNNQLD
CCCCCCCEEEEEEECCCCCCHHHHCCHHHHHHHHHHHCCCCCCHHHHHHHHHHCCCCCCC
RPRITTTKDLDLLIVVADEPGDVQRWMEQFWAREPALPVAILTTNEVLPQIQPYVDVNVN
CCCCCCCCCCEEEEEEECCCCHHHHHHHHHHCCCCCCCEEEEECHHHHHCCCCEEEEECC
GTPAAIYTAAGLVGEQQYMALRSNNTNTNTNGPITALSLGMITTVVVVLVGGLLQLQRRI
CCCHHHHHHHHHHCCHHHEEEECCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHH
RGKRNS
CCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA