Definition Herpetosiphon aurantiacus ATCC 23779 chromosome, complete genome.
Accession NC_009972
Length 6,346,587

Click here to switch to the map view.

The map label for this gene is 159896694

Identifier: 159896694

GI number: 159896694

Start: 190394

End: 195169

Strand: Direct

Name: 159896694

Synonym: Haur_0161

Alternate gene names: NA

Gene position: 190394-195169 (Clockwise)

Preceding gene: 159896693

Following gene: 159896695

Centisome position: 3.0

GC content: 53.31

Gene sequence:

>4776_bases
ATGCGATTGCTCGAAAAACTAGCACGATGGTGGTGGCGTTGGCTTCTAACAACAATTAGTTTGTTGGGCACGGCGCTGCT
TGGCGTAATCGTGGCGAGTATCGCTGGCTGGGTTCCGCAACCAAGTGTTTTGCGCTTAACGCCGTTGGCTGGTAGCCGCG
AATTGCCGCCAGCCACGGCCTTGGAATTTAATTTCAATCTGCCGATGGATCGTTCGAGCGTCGAGGATGCTTTGGTGATT
ACGCCGCCGGTGCGTGGACGTTGGCATTGGGAAGGCCGCGCCCGTGCCCGTTGGCAGCCTGAATTTGGCTGGACACCAGG
CACAACCGTGACGGTGCAATTACGCCCAACCGCCCAATCGATGTTGCGCCAAACCCTGGCAACAACCGTGACAACCCAAT
TTACCGCCGCTCCTGCCCCGCTGTTAGTGTTTCGCTCACCGCTACCCAATGCGATTATTGCCCCCAATACCCCGATTTTG
TTGCGTTTCAATCGGGCGATGATCGATTATGCCAGCCAAACTGAGCGGGGCTTAGCTGAATTAAGCATCGAGCCAAATGC
TGCTAGCCAAGTGCGTTGGCTCGATGATCGTAGCGTTTTGGTGCAGGCGCAATGGCAGATTGGTCAGCACTATCAACTCA
AGCTGCAAGATCTCAACGATCTGCTGGGAATTCCGGTTCAGACCACCGAATGGCAAGTGCAGGTGAGCGAGCCAAACCTG
ATTGCTCCGCCAACGACCCAAACCCTTCAGGCTGATCAAGCCTTGGAATGGGCCTTTGAGGGTTTGCTTGATCAAACCAC
AACCCAACAATTGATCAAACGAATTCAATTTACTCCCGCTGTGAGCACAACCTGGCAGGTGCAATATCAGCCTGATCCCC
AACCACAAACCATCATTCAAGCCTTGCCTGAGGCAGCTTGGCCAGCTCAAACGCTGACTACCAGCCTACAACTCAGCCAG
CCAATCACCCAAGTTTGGCAAATTCAACCCAACTTGCAATTAATTGGCTCAGTGCCAGGCCGTGGTGGCAGTTTAGCCGT
TGATGATCCGCTGCGCTTGCTGTTCAACCAAACGCCTGAGCGCCAGCAACTTGTCGAGCAACTATTTATCGAGCCTGAAG
TTGCGAATGTGGCGATTAACATCAACAATCAGCAGGCCTTGATTAGTGCTGCATGGCAACCAAGCACAGTTTACACGCTG
ACCTTGGCTGGCTCTGCCCCGCTGACCTTTCGCACCCAAACCCAAGCGCAGCCACTGCAAATTGAAGGTGCGGCTTATTC
GTTGTTGTTGCCGGAAACTACCGCCGAATTGCGGTTGAGTGGGCGCGAAAATAGCCGACTCACGGCGAATCTGTATGCGG
TTGATCGGGCGGTTTTGGCGGCGGCTTTGCAACAACCGCAAACCCCGCTTAATCCTCAGCGTTATAATTTGCAACCGCAA
CAGCAATGGCAAATTGCCGCTGGCCCTGAACGAACCATTAGCATTACCCCAACTCAAGCGGCGTTATTACTGCAAGTGCA
AGCTCCCAATGCCGAACTTGTGCAACATGTGTTGATTTGGACTCCCTATCGAGCGCAATTGTTGGCGACACCTGAGCAAG
CCCAAGCGTGGATTGTTGATCTGGTCAATCGCCAACCAGTCGCCGCCGCAAATTTGAGCATTTTGGCGGGTGCAAATCAA
CTTGCCACAGGCCAGAGCGATTCGCAAGGGCTTTGGCAAAGCTCAATTCAGGGCAGTAGCGGGCGTTTGGTCTTGCTTGG
CGGCGAGCCGCAAGCGCCGATTGTGGCTGAAACGATTATTCGACCACAACGCCAAGCACCAAGTTTGAGTAGCCAATTGC
TGCTTGACCGCCAGAGCTACCTAGCCAACCAACAACTGACGATTATCGGCAGCAGCGAGTTTGCTGCGGATGGGATGACT
ACGCCAACCCTAACCTTGGCAGTGCTTGATCCTAGTGGCCAAGCGATTGCGCCCGAACAAACCTTGGTGCTAAGCCAAAG
TCTCTGGATAACCAAGGTGCAACTGGCCGCCGATGTTCAACCTGGTTTGTATGAAGTGCGGCTGCGCTATGCCAACCAAG
TGATTGCGAGCCAAAATTTTGTGGTCAATCAGCCCGATTTGGCCTATCGCGTAGTTTTACCCGAATTGCAAGCGACCAAT
GCGATCGTGTCAGCTGAAATCATCAGCGATTTACCGAGCCAACATGGCCTGTGGCGCTTGCTTGATCAGCGTAATCGCCA
AGTGAATGCTGGCAGTTGGCATAGCAACGCCGCTGGAATTGCCCAGTTCGATTATCAACAGAGCCAAACGTTGTTGGGCG
ATTATGTGCTCGAAATTCAGCTTGGTGAGCAAGTTAGCTATCATCCCAGCCAAATTCACTATCCTGCGCAATTAGCTGCC
AAGGCTGAGCAACAGTTGCTCAATCCCAATCAACCAGCCACGATCAACTTCCAGCTGCGCGATCAACAGGGTATGGCTTT
GAGCAATCGTGCTTTGCAAATCGAAGTTCAAGGCGCAATTAGCAGCACCCAAAGTTTGCGTACCAATGCTGCTGGCGAAG
TTGTTTGGCGCACCAATGGTTTGCGGGCGGGCCTGTGGCTGATTCGTGCCAGTAGCCCAGATGCGGCCAGCGTGGAAGTG
CCTTTGTGGGTGTTGGGGGCCAAGAGCGATCAATTGATTGGTCGGAGCCAAAGTAGCTTGGTCGAAACAACTGAACTCGC
GCTTGCCCCGCTGACCAATCTGGCGGCTACTAATGTGTTGGTTAGTTGGTTTGAAGGTAGCAGCATTCGCCAGCAGATTC
AGCCTTGGGTTGCGGGCCAGAGCATCGCGATTACGCCCAGTCTGAGCAATACTCAGCAATTAGAGGTAGCTTTGGCTTGG
CTTGATGCTGAGCAGTTAATCAGTAGCAGCAGCCAAATTCCCTTCCAAGCAGTTGCGCCACTCGATTTGACGATGGTTGT
GAGCGGTTCGCAATTGGTGCTGGCAACCCAACGCGCTGGTCGTCCTGTTGCCAGCATGGTTGGCTTGAGTTTTCAGTCAA
TCCAAACGTCAGCTAGCCAACAACGGCTTGTGCGCACAGCCAGCAATGGCCAAGCAGTGCTCGATTTACAAGGATTTGGC
GAGGGTTGGCGGATTCAGGCCTTAGCCAGTGATGGCTTGAATAGCGCCGAAGCCACGACGTTGTATGCAGCAAATCCCTT
GATCGATGCCCAAATGCTGTTGCCCGAACGCTTGATTGTGGGCGATCAACTGAGCGTGACCGCTCGCTTGAATTTGCTAG
CGACTCGCGGTGGGATTCCTAGCGTTAGCCTGAGCGTCGATTCGGCTTATCTTGCGGCCTTGGCTGAGCCAACCACGGGC
AATAGTGGCCGAATTTATACCACAACTCAAGCCTTGGTTGCCGCCAACCTTGGTACGACCACGCTCACCGCAACCATTGA
AGTTAATCAGCAAACCCAAATTATCACCAAAGCCCTGACGATTCAGCCACCAAGCCAAGTGCGTTTGCAACAAAGCCGTT
TGTTGACCGAAGCGACCGATATTACTTGGCAAGTGCCGACGGCCAACCAAGCAGCCTCAATTAATATTGTGATTGCTAGT
TTAGCCCAAGCCAGCCAAGCCTTGCCTAGCCAATTGCCGGGCGATGATCCCCTGACGTTGGCTGGGCGAATTGCGCTATC
CCGCTATGCAGCGCAGCCTGCGCAGGCCGAGATTGAATTATTGGCCAAGCAGCAACTTACCAATGGCAGCTGGAGTTGGG
ATGCGCAAGCGGGCGATTTGCAATTGACTGCCTTGATTGTGCAACTGATTGCGACCGAGCAACGTTCGCCCCAACTGCGC
CAACTCGAAGATCAAGCCGCTCGTTGGTTAGCCTTGGTTAGTCCACTTGATCCCGATTTGCGCAGCGAAATGCTGTTGGC
CTTGGCGCACAGCGGCAAAACAGTTGAAGCTCAAATCACCAGCTTGCTCAAAAATCGCCAATTAACCACTGCCCAACGCT
TGCGCTTGATCTATGCCTTGGTGCTGCTCGATTCGCCTCAAGCCGATCAATATTTGCTTGAAGTGAGCCAGATGTTGGCT
CAACCCCTAACGCCAAGTGCTTGGATGAGTCGCACCCGCCAAGCGGCGCTGATCGGCTTGATTTTTGAGCGCAGCCAACC
AAGTTCAGCCTTACGTGCCCAAGTGCTCAAACTGATCGCCGAGGGCTGGAATGGCACGACATGGGAAGATTTGCCAAGTA
GCGTAGCGGTATTTCAGCTAACCCAACAAGATTTTCCAACCCGTGGGGATTATCGTTTGGGCTTGAATGGCGCAGCCTTG
AGCGATTATGATCAAGCTAGCAGCCTAATGTTGCCAATTACCAACCAACTTAACGTGCAGATCGAGCCGAATGGCCCAAT
CTTGTTGGCGAGTCAAGCTAGCTGGCAAAACCCTGCTACCCAAGCCTACTTGCTCCATTCCAGCAGCGAAGATCAATTGG
CTTATGGTGAGCAATGGTTGTGGCAAGGCTATTTGGTGCTTGAACAAGATCTGTCATTGTTACAACTACGTTTGGCTGCG
CCGAGTGGTGTGGAGTGGCAGCTTGGTTCAGCTACAGGCTTGAATTGGCATGATGGTCTGTTCAGTGCCGCCAACGTTCG
GGCTGGCATTTACCCCATTCAACTATTGGGCGTAGCTCGCCACAAGGGCCAATTTGCTTGGCCAGCGCCCCAATTAACCA
GTGGCGGCCAGATCGTTGAGCTTAAACAAACCGCGCCGCCAGTGCTAATTCGCTGA

Upstream 100 bases:

>100_bases
ATGGATCAAATCAAGGTGGTTGTGCCAATTTGGAAATGTGAGCACTGGACCGATGGTTCGCAAGAATGGGTGGGTCAGCG
TTGAAGCACTAAGGTGAGCT

Downstream 100 bases:

>100_bases
TGGTACAATAGACATATCTTTATTTTCAGAATTAAGGCACATCAATGCGTATTCCAGAAGCAATTCAATGGATTGAACAA
TCGGGCAATGTTTTAGCCCA

Product: hypothetical protein

Products: NA

Alternate protein names: Large Extracellular Alpha-Helical Protein-Like Protein

Number of amino acids: Translated: 1591; Mature: 1591

Protein sequence:

>1591_residues
MRLLEKLARWWWRWLLTTISLLGTALLGVIVASIAGWVPQPSVLRLTPLAGSRELPPATALEFNFNLPMDRSSVEDALVI
TPPVRGRWHWEGRARARWQPEFGWTPGTTVTVQLRPTAQSMLRQTLATTVTTQFTAAPAPLLVFRSPLPNAIIAPNTPIL
LRFNRAMIDYASQTERGLAELSIEPNAASQVRWLDDRSVLVQAQWQIGQHYQLKLQDLNDLLGIPVQTTEWQVQVSEPNL
IAPPTTQTLQADQALEWAFEGLLDQTTTQQLIKRIQFTPAVSTTWQVQYQPDPQPQTIIQALPEAAWPAQTLTTSLQLSQ
PITQVWQIQPNLQLIGSVPGRGGSLAVDDPLRLLFNQTPERQQLVEQLFIEPEVANVAININNQQALISAAWQPSTVYTL
TLAGSAPLTFRTQTQAQPLQIEGAAYSLLLPETTAELRLSGRENSRLTANLYAVDRAVLAAALQQPQTPLNPQRYNLQPQ
QQWQIAAGPERTISITPTQAALLLQVQAPNAELVQHVLIWTPYRAQLLATPEQAQAWIVDLVNRQPVAAANLSILAGANQ
LATGQSDSQGLWQSSIQGSSGRLVLLGGEPQAPIVAETIIRPQRQAPSLSSQLLLDRQSYLANQQLTIIGSSEFAADGMT
TPTLTLAVLDPSGQAIAPEQTLVLSQSLWITKVQLAADVQPGLYEVRLRYANQVIASQNFVVNQPDLAYRVVLPELQATN
AIVSAEIISDLPSQHGLWRLLDQRNRQVNAGSWHSNAAGIAQFDYQQSQTLLGDYVLEIQLGEQVSYHPSQIHYPAQLAA
KAEQQLLNPNQPATINFQLRDQQGMALSNRALQIEVQGAISSTQSLRTNAAGEVVWRTNGLRAGLWLIRASSPDAASVEV
PLWVLGAKSDQLIGRSQSSLVETTELALAPLTNLAATNVLVSWFEGSSIRQQIQPWVAGQSIAITPSLSNTQQLEVALAW
LDAEQLISSSSQIPFQAVAPLDLTMVVSGSQLVLATQRAGRPVASMVGLSFQSIQTSASQQRLVRTASNGQAVLDLQGFG
EGWRIQALASDGLNSAEATTLYAANPLIDAQMLLPERLIVGDQLSVTARLNLLATRGGIPSVSLSVDSAYLAALAEPTTG
NSGRIYTTTQALVAANLGTTTLTATIEVNQQTQIITKALTIQPPSQVRLQQSRLLTEATDITWQVPTANQAASINIVIAS
LAQASQALPSQLPGDDPLTLAGRIALSRYAAQPAQAEIELLAKQQLTNGSWSWDAQAGDLQLTALIVQLIATEQRSPQLR
QLEDQAARWLALVSPLDPDLRSEMLLALAHSGKTVEAQITSLLKNRQLTTAQRLRLIYALVLLDSPQADQYLLEVSQMLA
QPLTPSAWMSRTRQAALIGLIFERSQPSSALRAQVLKLIAEGWNGTTWEDLPSSVAVFQLTQQDFPTRGDYRLGLNGAAL
SDYDQASSLMLPITNQLNVQIEPNGPILLASQASWQNPATQAYLLHSSSEDQLAYGEQWLWQGYLVLEQDLSLLQLRLAA
PSGVEWQLGSATGLNWHDGLFSAANVRAGIYPIQLLGVARHKGQFAWPAPQLTSGGQIVELKQTAPPVLIR

Sequences:

>Translated_1591_residues
MRLLEKLARWWWRWLLTTISLLGTALLGVIVASIAGWVPQPSVLRLTPLAGSRELPPATALEFNFNLPMDRSSVEDALVI
TPPVRGRWHWEGRARARWQPEFGWTPGTTVTVQLRPTAQSMLRQTLATTVTTQFTAAPAPLLVFRSPLPNAIIAPNTPIL
LRFNRAMIDYASQTERGLAELSIEPNAASQVRWLDDRSVLVQAQWQIGQHYQLKLQDLNDLLGIPVQTTEWQVQVSEPNL
IAPPTTQTLQADQALEWAFEGLLDQTTTQQLIKRIQFTPAVSTTWQVQYQPDPQPQTIIQALPEAAWPAQTLTTSLQLSQ
PITQVWQIQPNLQLIGSVPGRGGSLAVDDPLRLLFNQTPERQQLVEQLFIEPEVANVAININNQQALISAAWQPSTVYTL
TLAGSAPLTFRTQTQAQPLQIEGAAYSLLLPETTAELRLSGRENSRLTANLYAVDRAVLAAALQQPQTPLNPQRYNLQPQ
QQWQIAAGPERTISITPTQAALLLQVQAPNAELVQHVLIWTPYRAQLLATPEQAQAWIVDLVNRQPVAAANLSILAGANQ
LATGQSDSQGLWQSSIQGSSGRLVLLGGEPQAPIVAETIIRPQRQAPSLSSQLLLDRQSYLANQQLTIIGSSEFAADGMT
TPTLTLAVLDPSGQAIAPEQTLVLSQSLWITKVQLAADVQPGLYEVRLRYANQVIASQNFVVNQPDLAYRVVLPELQATN
AIVSAEIISDLPSQHGLWRLLDQRNRQVNAGSWHSNAAGIAQFDYQQSQTLLGDYVLEIQLGEQVSYHPSQIHYPAQLAA
KAEQQLLNPNQPATINFQLRDQQGMALSNRALQIEVQGAISSTQSLRTNAAGEVVWRTNGLRAGLWLIRASSPDAASVEV
PLWVLGAKSDQLIGRSQSSLVETTELALAPLTNLAATNVLVSWFEGSSIRQQIQPWVAGQSIAITPSLSNTQQLEVALAW
LDAEQLISSSSQIPFQAVAPLDLTMVVSGSQLVLATQRAGRPVASMVGLSFQSIQTSASQQRLVRTASNGQAVLDLQGFG
EGWRIQALASDGLNSAEATTLYAANPLIDAQMLLPERLIVGDQLSVTARLNLLATRGGIPSVSLSVDSAYLAALAEPTTG
NSGRIYTTTQALVAANLGTTTLTATIEVNQQTQIITKALTIQPPSQVRLQQSRLLTEATDITWQVPTANQAASINIVIAS
LAQASQALPSQLPGDDPLTLAGRIALSRYAAQPAQAEIELLAKQQLTNGSWSWDAQAGDLQLTALIVQLIATEQRSPQLR
QLEDQAARWLALVSPLDPDLRSEMLLALAHSGKTVEAQITSLLKNRQLTTAQRLRLIYALVLLDSPQADQYLLEVSQMLA
QPLTPSAWMSRTRQAALIGLIFERSQPSSALRAQVLKLIAEGWNGTTWEDLPSSVAVFQLTQQDFPTRGDYRLGLNGAAL
SDYDQASSLMLPITNQLNVQIEPNGPILLASQASWQNPATQAYLLHSSSEDQLAYGEQWLWQGYLVLEQDLSLLQLRLAA
PSGVEWQLGSATGLNWHDGLFSAANVRAGIYPIQLLGVARHKGQFAWPAPQLTSGGQIVELKQTAPPVLIR
>Mature_1591_residues
MRLLEKLARWWWRWLLTTISLLGTALLGVIVASIAGWVPQPSVLRLTPLAGSRELPPATALEFNFNLPMDRSSVEDALVI
TPPVRGRWHWEGRARARWQPEFGWTPGTTVTVQLRPTAQSMLRQTLATTVTTQFTAAPAPLLVFRSPLPNAIIAPNTPIL
LRFNRAMIDYASQTERGLAELSIEPNAASQVRWLDDRSVLVQAQWQIGQHYQLKLQDLNDLLGIPVQTTEWQVQVSEPNL
IAPPTTQTLQADQALEWAFEGLLDQTTTQQLIKRIQFTPAVSTTWQVQYQPDPQPQTIIQALPEAAWPAQTLTTSLQLSQ
PITQVWQIQPNLQLIGSVPGRGGSLAVDDPLRLLFNQTPERQQLVEQLFIEPEVANVAININNQQALISAAWQPSTVYTL
TLAGSAPLTFRTQTQAQPLQIEGAAYSLLLPETTAELRLSGRENSRLTANLYAVDRAVLAAALQQPQTPLNPQRYNLQPQ
QQWQIAAGPERTISITPTQAALLLQVQAPNAELVQHVLIWTPYRAQLLATPEQAQAWIVDLVNRQPVAAANLSILAGANQ
LATGQSDSQGLWQSSIQGSSGRLVLLGGEPQAPIVAETIIRPQRQAPSLSSQLLLDRQSYLANQQLTIIGSSEFAADGMT
TPTLTLAVLDPSGQAIAPEQTLVLSQSLWITKVQLAADVQPGLYEVRLRYANQVIASQNFVVNQPDLAYRVVLPELQATN
AIVSAEIISDLPSQHGLWRLLDQRNRQVNAGSWHSNAAGIAQFDYQQSQTLLGDYVLEIQLGEQVSYHPSQIHYPAQLAA
KAEQQLLNPNQPATINFQLRDQQGMALSNRALQIEVQGAISSTQSLRTNAAGEVVWRTNGLRAGLWLIRASSPDAASVEV
PLWVLGAKSDQLIGRSQSSLVETTELALAPLTNLAATNVLVSWFEGSSIRQQIQPWVAGQSIAITPSLSNTQQLEVALAW
LDAEQLISSSSQIPFQAVAPLDLTMVVSGSQLVLATQRAGRPVASMVGLSFQSIQTSASQQRLVRTASNGQAVLDLQGFG
EGWRIQALASDGLNSAEATTLYAANPLIDAQMLLPERLIVGDQLSVTARLNLLATRGGIPSVSLSVDSAYLAALAEPTTG
NSGRIYTTTQALVAANLGTTTLTATIEVNQQTQIITKALTIQPPSQVRLQQSRLLTEATDITWQVPTANQAASINIVIAS
LAQASQALPSQLPGDDPLTLAGRIALSRYAAQPAQAEIELLAKQQLTNGSWSWDAQAGDLQLTALIVQLIATEQRSPQLR
QLEDQAARWLALVSPLDPDLRSEMLLALAHSGKTVEAQITSLLKNRQLTTAQRLRLIYALVLLDSPQADQYLLEVSQMLA
QPLTPSAWMSRTRQAALIGLIFERSQPSSALRAQVLKLIAEGWNGTTWEDLPSSVAVFQLTQQDFPTRGDYRLGLNGAAL
SDYDQASSLMLPITNQLNVQIEPNGPILLASQASWQNPATQAYLLHSSSEDQLAYGEQWLWQGYLVLEQDLSLLQLRLAA
PSGVEWQLGSATGLNWHDGLFSAANVRAGIYPIQLLGVARHKGQFAWPAPQLTSGGQIVELKQTAPPVLIR

Specific function: Unknown

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 173371; Mature: 173371

Theoretical pI: Translated: 4.91; Mature: 4.91

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.0 %Cys     (Translated Protein)
0.8 %Met     (Translated Protein)
0.8 %Cys+Met (Translated Protein)
0.0 %Cys     (Mature Protein)
0.8 %Met     (Mature Protein)
0.8 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MRLLEKLARWWWRWLLTTISLLGTALLGVIVASIAGWVPQPSVLRLTPLAGSRELPPATA
CHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCEEEEECCCCCCCCCCCEE
LEFNFNLPMDRSSVEDALVITPPVRGRWHWEGRARARWQPEFGWTPGTTVTVQLRPTAQS
EEEEECCCCCCCCCCCEEEECCCCCCEEEECCCCCCEECCCCCCCCCCEEEEEECCCHHH
MLRQTLATTVTTQFTAAPAPLLVFRSPLPNAIIAPNTPILLRFNRAMIDYASQTERGLAE
HHHHHHHHHHHHEECCCCCCEEEECCCCCCCEECCCCCEEEEECHHHHHHHHHHHCCCEE
LSIEPNAASQVRWLDDRSVLVQAQWQIGQHYQLKLQDLNDLLGIPVQTTEWQVQVSEPNL
EEECCCCCCCEEEECCCEEEEEEEECCCCEEEEEEECCHHHHCCCCCCCEEEEEECCCCE
IAPPTTQTLQADQALEWAFEGLLDQTTTQQLIKRIQFTPAVSTTWQVQYQPDPQPQTIIQ
ECCCCCHHHHHHHHHHHHHHHHHCHHHHHHHHHHHCCCCCCCEEEEEEECCCCCHHHHHH
ALPEAAWPAQTLTTSLQLSQPITQVWQIQPNLQLIGSVPGRGGSLAVDDPLRLLFNQTPE
HCCCCCCCHHHHHHHHHHHCCHHHHHCCCCCEEEEECCCCCCCCEEECCHHHHHHCCCCC
RQQLVEQLFIEPEVANVAININNQQALISAAWQPSTVYTLTLAGSAPLTFRTQTQAQPLQ
HHHHHHHHHCCCCEEEEEEEECCCEEEEEECCCCCEEEEEEEECCCCEEEEECCCCCCEE
IEGAAYSLLLPETTAELRLSGRENSRLTANLYAVDRAVLAAALQQPQTPLNPQRYNLQPQ
ECCCEEEEECCCCCEEEEECCCCCCEEEEEHHHHHHHHHHHHHHCCCCCCCCCCCCCCHH
QQWQIAAGPERTISITPTQAALLLQVQAPNAELVQHVLIWTPYRAQLLATPEQAQAWIVD
HCEEEECCCCCEEEECCCCEEEEEEEECCCHHHHHHHHEECCCHHEEECCCHHHHHHHHH
LVNRQPVAAANLSILAGANQLATGQSDSQGLWQSSIQGSSGRLVLLGGEPQAPIVAETII
HHCCCCCCCCCEEEEECCCHHCCCCCCCCCHHHHHCCCCCCCEEEECCCCCCCHHHHHHC
RPQRQAPSLSSQLLLDRQSYLANQQLTIIGSSEFAADGMTTPTLTLAVLDPSGQAIAPEQ
CCCCCCCCCHHHHHHHHHHHHCCCEEEEEECCCCCCCCCCCCEEEEEEECCCCCEECCCC
TLVLSQSLWITKVQLAADVQPGLYEVRLRYANQVIASQNFVVNQPDLAYRVVLPELQATN
EEEEECCCEEEEEEEEECCCCCHHHHHHHHHHHHHHCCCEEECCCCCEEEEEECCHHHCC
AIVSAEIISDLPSQHGLWRLLDQRNRQVNAGSWHSNAAGIAQFDYQQSQTLLGDYVLEIQ
HHHHHHHHHHCCCCCCHHHHHHHCCCCCCCCCCCCCCCCCEEECCHHHHHHHCEEEEEEE
LGEQVSYHPSQIHYPAQLAAKAEQQLLNPNQPATINFQLRDQQGMALSNRALQIEVQGAI
ECCCCCCCCCCCCCHHHHHHHHHHHHCCCCCCEEEEEEEECCCCCEECCCEEEEEEECCC
SSTQSLRTNAAGEVVWRTNGLRAGLWLIRASSPDAASVEVPLWVLGAKSDQLIGRSQSSL
CCHHHHHCCCCCEEEEECCCCEEEEEEEEECCCCCCEEEEEEEEEECCCCHHCCCCHHHH
VETTELALAPLTNLAATNVLVSWFEGSSIRQQIQPWVAGQSIAITPSLSNTQQLEVALAW
HHHHHHHHHHHHHHHHHHHHEEECCCCHHHHHHHHHHCCCEEEEECCCCCCCEEEEEEEE
LDAEQLISSSSQIPFQAVAPLDLTMVVSGSQLVLATQRAGRPVASMVGLSFQSIQTSASQ
ECHHHHHCCCCCCCEEEECCCEEEEEECCCEEEEEECCCCCCHHHHHCCCHHHHHHHHHH
QRLVRTASNGQAVLDLQGFGEGWRIQALASDGLNSAEATTLYAANPLIDAQMLLPERLIV
HHHHHCCCCCCEEEEEECCCCCEEEEEEECCCCCCCCCEEEEECCCCCCHHHHCCCHHEE
GDQLSVTARLNLLATRGGIPSVSLSVDSAYLAALAEPTTGNSGRIYTTTQALVAANLGTT
CCCEEEEEEEEEEEECCCCCEEEEEECHHHHHHCCCCCCCCCCEEEEEEHEEEEECCCCE
TLTATIEVNQQTQIITKALTIQPPSQVRLQQSRLLTEATDITWQVPTANQAASINIVIAS
EEEEEEEECCCCEEEEEEEECCCCHHHHHHHHHHHHHHCCCEEECCCCCCCCEEEEEEEH
LAQASQALPSQLPGDDPLTLAGRIALSRYAAQPAQAEIELLAKQQLTNGSWSWDAQAGDL
HHHHHHHCHHCCCCCCCEEHHHHHHHHHHHCCCCHHHHHHHHHHHCCCCCCEECCCCCCC
QLTALIVQLIATEQRSPQLRQLEDQAARWLALVSPLDPDLRSEMLLALAHSGKTVEAQIT
HHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHEECCCCCCHHHHHHHHHHCCCCCHHHHHH
SLLKNRQLTTAQRLRLIYALVLLDSPQADQYLLEVSQMLAQPLTPSAWMSRTRQAALIGL
HHHHCCCCHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHCCCCCHHHHHHHHHHEEEEE
IFERSQPSSALRAQVLKLIAEGWNGTTWEDLPSSVAVFQLTQQDFPTRGDYRLGLNGAAL
EEECCCCHHHHHHHHHHHHHCCCCCCCHHHCCCCEEEEEEEHHCCCCCCCEEECCCCCCC
SDYDQASSLMLPITNQLNVQIEPNGPILLASQASWQNPATQAYLLHSSSEDQLAYGEQWL
CCCCCCCCEEEEECCCEEEEECCCCCEEEEECCCCCCCCCEEEEEECCCCCCHHHCCHHH
WQGYLVLEQDLSLLQLRLAAPSGVEWQLGSATGLNWHDGLFSAANVRAGIYPIQLLGVAR
HCCEEEEECCHHEEEEEECCCCCCEEEECCCCCCCCCCCCCCCCCCCCCCEEEEEEEEHH
HKGQFAWPAPQLTSGGQIVELKQTAPPVLIR
HCCCCCCCCCCCCCCCCEEEEECCCCCEEEC
>Mature Secondary Structure
MRLLEKLARWWWRWLLTTISLLGTALLGVIVASIAGWVPQPSVLRLTPLAGSRELPPATA
CHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCEEEEECCCCCCCCCCCEE
LEFNFNLPMDRSSVEDALVITPPVRGRWHWEGRARARWQPEFGWTPGTTVTVQLRPTAQS
EEEEECCCCCCCCCCCEEEECCCCCCEEEECCCCCCEECCCCCCCCCCEEEEEECCCHHH
MLRQTLATTVTTQFTAAPAPLLVFRSPLPNAIIAPNTPILLRFNRAMIDYASQTERGLAE
HHHHHHHHHHHHEECCCCCCEEEECCCCCCCEECCCCCEEEEECHHHHHHHHHHHCCCEE
LSIEPNAASQVRWLDDRSVLVQAQWQIGQHYQLKLQDLNDLLGIPVQTTEWQVQVSEPNL
EEECCCCCCCEEEECCCEEEEEEEECCCCEEEEEEECCHHHHCCCCCCCEEEEEECCCCE
IAPPTTQTLQADQALEWAFEGLLDQTTTQQLIKRIQFTPAVSTTWQVQYQPDPQPQTIIQ
ECCCCCHHHHHHHHHHHHHHHHHCHHHHHHHHHHHCCCCCCCEEEEEEECCCCCHHHHHH
ALPEAAWPAQTLTTSLQLSQPITQVWQIQPNLQLIGSVPGRGGSLAVDDPLRLLFNQTPE
HCCCCCCCHHHHHHHHHHHCCHHHHHCCCCCEEEEECCCCCCCCEEECCHHHHHHCCCCC
RQQLVEQLFIEPEVANVAININNQQALISAAWQPSTVYTLTLAGSAPLTFRTQTQAQPLQ
HHHHHHHHHCCCCEEEEEEEECCCEEEEEECCCCCEEEEEEEECCCCEEEEECCCCCCEE
IEGAAYSLLLPETTAELRLSGRENSRLTANLYAVDRAVLAAALQQPQTPLNPQRYNLQPQ
ECCCEEEEECCCCCEEEEECCCCCCEEEEEHHHHHHHHHHHHHHCCCCCCCCCCCCCCHH
QQWQIAAGPERTISITPTQAALLLQVQAPNAELVQHVLIWTPYRAQLLATPEQAQAWIVD
HCEEEECCCCCEEEECCCCEEEEEEEECCCHHHHHHHHEECCCHHEEECCCHHHHHHHHH
LVNRQPVAAANLSILAGANQLATGQSDSQGLWQSSIQGSSGRLVLLGGEPQAPIVAETII
HHCCCCCCCCCEEEEECCCHHCCCCCCCCCHHHHHCCCCCCCEEEECCCCCCCHHHHHHC
RPQRQAPSLSSQLLLDRQSYLANQQLTIIGSSEFAADGMTTPTLTLAVLDPSGQAIAPEQ
CCCCCCCCCHHHHHHHHHHHHCCCEEEEEECCCCCCCCCCCCEEEEEEECCCCCEECCCC
TLVLSQSLWITKVQLAADVQPGLYEVRLRYANQVIASQNFVVNQPDLAYRVVLPELQATN
EEEEECCCEEEEEEEEECCCCCHHHHHHHHHHHHHHCCCEEECCCCCEEEEEECCHHHCC
AIVSAEIISDLPSQHGLWRLLDQRNRQVNAGSWHSNAAGIAQFDYQQSQTLLGDYVLEIQ
HHHHHHHHHHCCCCCCHHHHHHHCCCCCCCCCCCCCCCCCEEECCHHHHHHHCEEEEEEE
LGEQVSYHPSQIHYPAQLAAKAEQQLLNPNQPATINFQLRDQQGMALSNRALQIEVQGAI
ECCCCCCCCCCCCCHHHHHHHHHHHHCCCCCCEEEEEEEECCCCCEECCCEEEEEEECCC
SSTQSLRTNAAGEVVWRTNGLRAGLWLIRASSPDAASVEVPLWVLGAKSDQLIGRSQSSL
CCHHHHHCCCCCEEEEECCCCEEEEEEEEECCCCCCEEEEEEEEEECCCCHHCCCCHHHH
VETTELALAPLTNLAATNVLVSWFEGSSIRQQIQPWVAGQSIAITPSLSNTQQLEVALAW
HHHHHHHHHHHHHHHHHHHHEEECCCCHHHHHHHHHHCCCEEEEECCCCCCCEEEEEEEE
LDAEQLISSSSQIPFQAVAPLDLTMVVSGSQLVLATQRAGRPVASMVGLSFQSIQTSASQ
ECHHHHHCCCCCCCEEEECCCEEEEEECCCEEEEEECCCCCCHHHHHCCCHHHHHHHHHH
QRLVRTASNGQAVLDLQGFGEGWRIQALASDGLNSAEATTLYAANPLIDAQMLLPERLIV
HHHHHCCCCCCEEEEEECCCCCEEEEEEECCCCCCCCCEEEEECCCCCCHHHHCCCHHEE
GDQLSVTARLNLLATRGGIPSVSLSVDSAYLAALAEPTTGNSGRIYTTTQALVAANLGTT
CCCEEEEEEEEEEEECCCCCEEEEEECHHHHHHCCCCCCCCCCEEEEEEHEEEEECCCCE
TLTATIEVNQQTQIITKALTIQPPSQVRLQQSRLLTEATDITWQVPTANQAASINIVIAS
EEEEEEEECCCCEEEEEEEECCCCHHHHHHHHHHHHHHCCCEEECCCCCCCCEEEEEEEH
LAQASQALPSQLPGDDPLTLAGRIALSRYAAQPAQAEIELLAKQQLTNGSWSWDAQAGDL
HHHHHHHCHHCCCCCCCEEHHHHHHHHHHHCCCCHHHHHHHHHHHCCCCCCEECCCCCCC
QLTALIVQLIATEQRSPQLRQLEDQAARWLALVSPLDPDLRSEMLLALAHSGKTVEAQIT
HHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHEECCCCCCHHHHHHHHHHCCCCCHHHHHH
SLLKNRQLTTAQRLRLIYALVLLDSPQADQYLLEVSQMLAQPLTPSAWMSRTRQAALIGL
HHHHCCCCHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHCCCCCHHHHHHHHHHEEEEE
IFERSQPSSALRAQVLKLIAEGWNGTTWEDLPSSVAVFQLTQQDFPTRGDYRLGLNGAAL
EEECCCCHHHHHHHHHHHHHCCCCCCCHHHCCCCEEEEEEEHHCCCCCCCEEECCCCCCC
SDYDQASSLMLPITNQLNVQIEPNGPILLASQASWQNPATQAYLLHSSSEDQLAYGEQWL
CCCCCCCCEEEEECCCEEEEECCCCCEEEEECCCCCCCCCEEEEEECCCCCCHHHCCHHH
WQGYLVLEQDLSLLQLRLAAPSGVEWQLGSATGLNWHDGLFSAANVRAGIYPIQLLGVAR
HCCEEEEECCHHEEEEEECCCCCCEEEECCCCCCCCCCCCCCCCCCCCCCEEEEEEEEHH
HKGQFAWPAPQLTSGGQIVELKQTAPPVLIR
HCCCCCCCCCCCCCCCCEEEEECCCCCEEEC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA