The gene/protein map for NC_012032 is currently unavailable.
Definition Chloroflexus sp. Y-400-fl chromosome, complete genome.
Accession NC_012032
Length 5,268,950

Click here to switch to the map view.

The map label for this gene is 222523983

Identifier: 222523983

GI number: 222523983

Start: 869626

End: 873264

Strand: Direct

Name: 222523983

Synonym: Chy400_0698

Alternate gene names: NA

Gene position: 869626-873264 (Clockwise)

Preceding gene: 222523982

Following gene: 222523984

Centisome position: 16.5

GC content: 50.18

Gene sequence:

>3639_bases
ATGGCAGCGTCCTGTATCCGTAGCATGCTGTTAGGCGGATTGTTTATTCTCCTGGTCTCATTCAATGCACCGGTGTTTAG
CATGCCGATCCTACACTCTTCACCATTGACCTCAGGTGCTAATCAGGCTGGTGACACCCAAGAATCGGGTGCTATCCCAT
TACCACGAGGTTGTGGCGGCGTCACACCGCCGGGGGAAGTAGAGACCACCTGCTGCCTGAACGGTATCGTATATGTTGAT
GGAGAGCCGGTTGCGGGGGCCGAAATTACGATCACCAGCTCACGTGGTACCAGTATTTCCCTGTACACCCGCTACATCAA
CACTGTTGACAACGTCCCATTTTACGAGATTAGCCTTAGTGACGATCCGCTACAAGTGCAAAGCGGTGAAACAATTACCA
TCACGGCACGACTTGGCAACCGAGAGCGTAGCCTGACTCATGAGGTGCAACCGGGAAGCCAACAAGTTGACATTGTGTTA
CCCCGCCGGAGTCCCAATGACTTTGTAGCCCTGCAATCAATACCGCTGCGCAGCATATCTGGCGAATTTGACGGCCTGAG
CGGTATTGCAATCAACCCTGAGTATCAGGTATTTGTGGTTGATCAAGAAGCGCATCAGATTCAGGCCTTTGATACTAATG
GTAATCCTCTTCAACCACCGTGGGGGCATTACGGGCAAAACCCAGGGCAATTTAACCTACCGCGTCGCGTAGTTGTTGAC
GCAAGCCGTAATGTCTATATCCTCGACGCCGGCAATCGTCGCATCCAAAAATTTGACCGACAGGGTCGCTATGTGCATTC
GTGGATGTTATGTACCCAACTCTCATCGTGTCCGTTCCCGTATGATCTTGCATTGGCGCCCGACGGAACTATTGCCGTTG
TCTACAATCAGGGAGTGACCATCTTCAGCACTACCGGTGATTTGCAGCGGCAATGGTCAACCGGTATCCATGGCACAGAC
ATCGACATTGATCGCAATGGAAACGTGTATATTACGACCGGACAATCTGATATATATACATTCACCCCTGGCGGTCAGTT
GACGACGACGCTGAACACACCGCTCACCTCTATTCAAAGCATGGCAATTGACCCAAGTGGCAACCTTTGGGTGACCGATC
CGATCAATGGTATCGTCCGTCTGTCAACCACCGGCGCAATTGCACAGCAATGGACGATTCCGGGTGAACTCTTTAACGAT
ATGGCCATTGCACCAAACGGTCAGCTTTACCTGACGAGTTACACTAATAAGGTGCTGGTATTTGACCCAACACGCGGTAC
AACTCGATCATGGGGCAGATCAAGCCGGTATCGTGATGTTATCGGAACGGTGACCGTGCCCAATAATACTTTGTTTATTG
CCAATCGTGAACCGGCTGCGGTTACCCGGTTGACATTCCAGCAATCTGTGACATCGACCCAAGTGGCGCTTAATCCGCTC
CCAAGACGCATTGTTGATATGACCAAAGCTGCTGATGGTTCGGTCTATATCCTTGATCAATCAAGCTCGACCACTGCCCG
CGTCTACAAAATCAATGCGCTCGGCCAACAACTCTTCTCATTTCCAATCAATGATGTCAGTGCAGGCGCAATTGCAGTAG
CGCAAAACGGCACTATCTTTATTGCGGAAGATCTCGATAATCAGGTCTTGCAATTCTCTGCCGATGGTCAATACCGTTCA
AGCTGGGGCGGGACGGGTAGCAAACCCGGAAGATTCTATTTACCCAGTGATCTGGTAATTGACTCAAATGGATATATCTA
CGTCGCTGATCGAGGTAATGAGCGTATTCAAAAATTGCGGCTGGACGGGACGGTGGAGAGAACGGTATCAGCTACCTTTG
ATCCTACTCTCGACAATGTATTGCAGGTATTTAATAACAACATCTATATCTATCGTGAAGACGCGATTCGGGTTCGTGAC
AGCGACCTTACCAGCCCTCCGTTGTACACTATTGAACTGAATAATCAGGTGAAAGGATGGGACATCGATCAGCATGGGAA
CATCTATGCCTTCAATCCGGATACGAGACAGATCGAGATATATCGCCCGATGCGGTTTACACAACCAATCGCCACGATCA
GTTACCTCAACCTGAGCAGTCTGAGTGCTGATGATACGCTGATAGTGCAGGGTATGGGCCAAGACAGTGATGAAACGAAC
ACCATCCATGCCTGGCGCTGGGAGTCAAACCAGAATGGTCAAATCAGCACCAGCCGAACATTAGCAATACCGGCTGCCAG
TTTGAGTAGCGGTACACACACGATTACGTTAAAAGTCCAGGATAATGAAGGCGAGTGGTCTCAACAGACCAGTCTCTCAG
TGTATGTTAGTCCACGCATTCAGAACATACCGGCCTGGACGATACTCCTTTACCTCGATGCCGATTATGCTGCCGATGGT
CAAGCATTACTGAAATCTTTCAATAACACTATCAGAAATCTTAAACAACTCAGTAATTCGTCTATTCGGATCGCTATCCA
GATCGATGGGCCACAAAACAACGATACTCGTCGCATACTTATTCATCCTGGTCAACCACCCAGCGAGAACAGCATATCAG
AACAAGCAATGGATGATCCACTTACACTGGCGAACTTCTTACGTTGGGGGCAAGAGACCTTCCCGGCACGGCACTACTAC
CTGGCTATTGCCAATCATGGGCAGGGCGTCCAGGGCATTGCCTGGGACTCGACGAGTGACGCACGTGATGATGGGAGAAG
AAACAACAGTGCGTATCTCACCATCAAAGAACTTGGTCAAGCGCTCAATGCACCCGGCGTCGCACCAATTGACGTGATTC
ACCTTGATGCCTGCTCGATGGGACTGCTAGAGGTCGCTTTTGAACTGAGGCCGCGAAGTGAAGTGCCACTCCGATCACGC
CTGCTCATCGCTTCGCAATACCTGGGCTGGAGCTTCTTCGCGTATGACGAATACGTTGCCGATATTACGGCAACAAGTAC
ACCAGAAATGGTTGCACGCACGGTGGTACAGATCTACGCCGATAAGTCAGTGCAGAAACGAGTACCATTCACTATTACCG
CCCTTGATCTCGGTCGCGTGACAACCGTTGCTTCTACCGTTGACCGCCTGGCTGCTGAGTTAGCTGCTTATGCCAATAAC
AGCAATGAACACTTCAACCAGGTACAGAACATTCGCAATAGCAGCAGCCATCTTAACAGCGATAATGACTACCGCAACGC
CCGTTCTGATGCATACGTGGACCTCCTGAGCTGGACCCGAAACGTCAGAGACAGCATTTCAGACCGGGCGATCCAACAAC
GGGCAGACGAGTTGATCAATGAATTGACCGGTACACAGTCATTTATCTTACCCAACCCTAACGGCCATCGAGTTGGAATC
GCAACCTTGCCTGCAAGGTACGGCAGTTACCGTATTGACCTGAGCGATGTGCATGGTATCTCGATATATTACCCTGACTA
CACCAGACGCAACGCCACCTTCAACAGTTATGTCAATAATTACCTGTTTGAGTTTACCCGTTACACCCGATGGAGTGAAC
TCTTAACCGCCGGTGTCGTAGCGTTGAATCCGGGAGACCCGGAAGTAGATGAGGGTCTCGCGCCATTAGCACCGCTCAGC
GTCGAGTATTATGTGCATGTACCGATGATTGTGCGGTAA

Upstream 100 bases:

>100_bases
ATGAAGCAAATTCAACATTGAAAACATATAGCCATGTGATTCGTGACGTGACATCAAGAGGGTTTGGAAACTCCATCACT
ATCAACAAGAGGAGTTGACT

Downstream 100 bases:

>100_bases
CACATATCCAGGCCACAACTGCAATTCATTCAGAGGCACGATTGTATCGTGTCTCTGAATGTTTGATCAATTGAAATCTG
GTATCAGTTATCAGACATCG

Product: NHL repeat containing protein

Products: NA

Alternate protein names: NHL Repeat-Containing Protein; FHA Domain-Containing Protein; Peptidase; PA14 Domain-Containing Protein; Clostripain Family; Fibronectin Type III Domain-Containing Protein; APHP Domain Protein; SMP-30/Gluconolaconase/LRE Domain Protein; Clostripain; PKD Domain Containing Protein; Cell Surface Protein; Forkhead-Associated Protein; Surface Layer Protein; Thrombospondin Type 3 Repeat Family

Number of amino acids: Translated: 1212; Mature: 1211

Protein sequence:

>1212_residues
MAASCIRSMLLGGLFILLVSFNAPVFSMPILHSSPLTSGANQAGDTQESGAIPLPRGCGGVTPPGEVETTCCLNGIVYVD
GEPVAGAEITITSSRGTSISLYTRYINTVDNVPFYEISLSDDPLQVQSGETITITARLGNRERSLTHEVQPGSQQVDIVL
PRRSPNDFVALQSIPLRSISGEFDGLSGIAINPEYQVFVVDQEAHQIQAFDTNGNPLQPPWGHYGQNPGQFNLPRRVVVD
ASRNVYILDAGNRRIQKFDRQGRYVHSWMLCTQLSSCPFPYDLALAPDGTIAVVYNQGVTIFSTTGDLQRQWSTGIHGTD
IDIDRNGNVYITTGQSDIYTFTPGGQLTTTLNTPLTSIQSMAIDPSGNLWVTDPINGIVRLSTTGAIAQQWTIPGELFND
MAIAPNGQLYLTSYTNKVLVFDPTRGTTRSWGRSSRYRDVIGTVTVPNNTLFIANREPAAVTRLTFQQSVTSTQVALNPL
PRRIVDMTKAADGSVYILDQSSSTTARVYKINALGQQLFSFPINDVSAGAIAVAQNGTIFIAEDLDNQVLQFSADGQYRS
SWGGTGSKPGRFYLPSDLVIDSNGYIYVADRGNERIQKLRLDGTVERTVSATFDPTLDNVLQVFNNNIYIYREDAIRVRD
SDLTSPPLYTIELNNQVKGWDIDQHGNIYAFNPDTRQIEIYRPMRFTQPIATISYLNLSSLSADDTLIVQGMGQDSDETN
TIHAWRWESNQNGQISTSRTLAIPAASLSSGTHTITLKVQDNEGEWSQQTSLSVYVSPRIQNIPAWTILLYLDADYAADG
QALLKSFNNTIRNLKQLSNSSIRIAIQIDGPQNNDTRRILIHPGQPPSENSISEQAMDDPLTLANFLRWGQETFPARHYY
LAIANHGQGVQGIAWDSTSDARDDGRRNNSAYLTIKELGQALNAPGVAPIDVIHLDACSMGLLEVAFELRPRSEVPLRSR
LLIASQYLGWSFFAYDEYVADITATSTPEMVARTVVQIYADKSVQKRVPFTITALDLGRVTTVASTVDRLAAELAAYANN
SNEHFNQVQNIRNSSSHLNSDNDYRNARSDAYVDLLSWTRNVRDSISDRAIQQRADELINELTGTQSFILPNPNGHRVGI
ATLPARYGSYRIDLSDVHGISIYYPDYTRRNATFNSYVNNYLFEFTRYTRWSELLTAGVVALNPGDPEVDEGLAPLAPLS
VEYYVHVPMIVR

Sequences:

>Translated_1212_residues
MAASCIRSMLLGGLFILLVSFNAPVFSMPILHSSPLTSGANQAGDTQESGAIPLPRGCGGVTPPGEVETTCCLNGIVYVD
GEPVAGAEITITSSRGTSISLYTRYINTVDNVPFYEISLSDDPLQVQSGETITITARLGNRERSLTHEVQPGSQQVDIVL
PRRSPNDFVALQSIPLRSISGEFDGLSGIAINPEYQVFVVDQEAHQIQAFDTNGNPLQPPWGHYGQNPGQFNLPRRVVVD
ASRNVYILDAGNRRIQKFDRQGRYVHSWMLCTQLSSCPFPYDLALAPDGTIAVVYNQGVTIFSTTGDLQRQWSTGIHGTD
IDIDRNGNVYITTGQSDIYTFTPGGQLTTTLNTPLTSIQSMAIDPSGNLWVTDPINGIVRLSTTGAIAQQWTIPGELFND
MAIAPNGQLYLTSYTNKVLVFDPTRGTTRSWGRSSRYRDVIGTVTVPNNTLFIANREPAAVTRLTFQQSVTSTQVALNPL
PRRIVDMTKAADGSVYILDQSSSTTARVYKINALGQQLFSFPINDVSAGAIAVAQNGTIFIAEDLDNQVLQFSADGQYRS
SWGGTGSKPGRFYLPSDLVIDSNGYIYVADRGNERIQKLRLDGTVERTVSATFDPTLDNVLQVFNNNIYIYREDAIRVRD
SDLTSPPLYTIELNNQVKGWDIDQHGNIYAFNPDTRQIEIYRPMRFTQPIATISYLNLSSLSADDTLIVQGMGQDSDETN
TIHAWRWESNQNGQISTSRTLAIPAASLSSGTHTITLKVQDNEGEWSQQTSLSVYVSPRIQNIPAWTILLYLDADYAADG
QALLKSFNNTIRNLKQLSNSSIRIAIQIDGPQNNDTRRILIHPGQPPSENSISEQAMDDPLTLANFLRWGQETFPARHYY
LAIANHGQGVQGIAWDSTSDARDDGRRNNSAYLTIKELGQALNAPGVAPIDVIHLDACSMGLLEVAFELRPRSEVPLRSR
LLIASQYLGWSFFAYDEYVADITATSTPEMVARTVVQIYADKSVQKRVPFTITALDLGRVTTVASTVDRLAAELAAYANN
SNEHFNQVQNIRNSSSHLNSDNDYRNARSDAYVDLLSWTRNVRDSISDRAIQQRADELINELTGTQSFILPNPNGHRVGI
ATLPARYGSYRIDLSDVHGISIYYPDYTRRNATFNSYVNNYLFEFTRYTRWSELLTAGVVALNPGDPEVDEGLAPLAPLS
VEYYVHVPMIVR
>Mature_1211_residues
AASCIRSMLLGGLFILLVSFNAPVFSMPILHSSPLTSGANQAGDTQESGAIPLPRGCGGVTPPGEVETTCCLNGIVYVDG
EPVAGAEITITSSRGTSISLYTRYINTVDNVPFYEISLSDDPLQVQSGETITITARLGNRERSLTHEVQPGSQQVDIVLP
RRSPNDFVALQSIPLRSISGEFDGLSGIAINPEYQVFVVDQEAHQIQAFDTNGNPLQPPWGHYGQNPGQFNLPRRVVVDA
SRNVYILDAGNRRIQKFDRQGRYVHSWMLCTQLSSCPFPYDLALAPDGTIAVVYNQGVTIFSTTGDLQRQWSTGIHGTDI
DIDRNGNVYITTGQSDIYTFTPGGQLTTTLNTPLTSIQSMAIDPSGNLWVTDPINGIVRLSTTGAIAQQWTIPGELFNDM
AIAPNGQLYLTSYTNKVLVFDPTRGTTRSWGRSSRYRDVIGTVTVPNNTLFIANREPAAVTRLTFQQSVTSTQVALNPLP
RRIVDMTKAADGSVYILDQSSSTTARVYKINALGQQLFSFPINDVSAGAIAVAQNGTIFIAEDLDNQVLQFSADGQYRSS
WGGTGSKPGRFYLPSDLVIDSNGYIYVADRGNERIQKLRLDGTVERTVSATFDPTLDNVLQVFNNNIYIYREDAIRVRDS
DLTSPPLYTIELNNQVKGWDIDQHGNIYAFNPDTRQIEIYRPMRFTQPIATISYLNLSSLSADDTLIVQGMGQDSDETNT
IHAWRWESNQNGQISTSRTLAIPAASLSSGTHTITLKVQDNEGEWSQQTSLSVYVSPRIQNIPAWTILLYLDADYAADGQ
ALLKSFNNTIRNLKQLSNSSIRIAIQIDGPQNNDTRRILIHPGQPPSENSISEQAMDDPLTLANFLRWGQETFPARHYYL
AIANHGQGVQGIAWDSTSDARDDGRRNNSAYLTIKELGQALNAPGVAPIDVIHLDACSMGLLEVAFELRPRSEVPLRSRL
LIASQYLGWSFFAYDEYVADITATSTPEMVARTVVQIYADKSVQKRVPFTITALDLGRVTTVASTVDRLAAELAAYANNS
NEHFNQVQNIRNSSSHLNSDNDYRNARSDAYVDLLSWTRNVRDSISDRAIQQRADELINELTGTQSFILPNPNGHRVGIA
TLPARYGSYRIDLSDVHGISIYYPDYTRRNATFNSYVNNYLFEFTRYTRWSELLTAGVVALNPGDPEVDEGLAPLAPLSV
EYYVHVPMIVR

Specific function: Unknown

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

Organism=Homo sapiens, GI84993742, Length=261, Percent_Identity=24.904214559387, Blast_Score=75, Evalue=5e-13,
Organism=Drosophila melanogaster, GI221330419, Length=220, Percent_Identity=27.2727272727273, Blast_Score=79, Evalue=2e-14,
Organism=Drosophila melanogaster, GI24655386, Length=220, Percent_Identity=27.2727272727273, Blast_Score=79, Evalue=2e-14,
Organism=Drosophila melanogaster, GI22024206, Length=220, Percent_Identity=27.2727272727273, Blast_Score=79, Evalue=2e-14,
Organism=Drosophila melanogaster, GI221330033, Length=116, Percent_Identity=33.6206896551724, Blast_Score=71, Evalue=4e-12,
Organism=Drosophila melanogaster, GI221330031, Length=116, Percent_Identity=33.6206896551724, Blast_Score=71, Evalue=4e-12,
Organism=Drosophila melanogaster, GI24586266, Length=116, Percent_Identity=33.6206896551724, Blast_Score=71, Evalue=4e-12,
Organism=Drosophila melanogaster, GI24586264, Length=116, Percent_Identity=33.6206896551724, Blast_Score=71, Evalue=4e-12,
Organism=Drosophila melanogaster, GI22026822, Length=116, Percent_Identity=33.6206896551724, Blast_Score=71, Evalue=4e-12,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 133806; Mature: 133675

Theoretical pI: Translated: 4.88; Mature: 4.88

Prosite motif: PS51125 NHL ; PS00678 WD_REPEATS_1

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.6 %Cys     (Translated Protein)
1.1 %Met     (Translated Protein)
1.7 %Cys+Met (Translated Protein)
0.6 %Cys     (Mature Protein)
1.0 %Met     (Mature Protein)
1.6 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MAASCIRSMLLGGLFILLVSFNAPVFSMPILHSSPLTSGANQAGDTQESGAIPLPRGCGG
CHHHHHHHHHHHHHHHHHHHCCCCEEEECCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC
VTPPGEVETTCCLNGIVYVDGEPVAGAEITITSSRGTSISLYTRYINTVDNVPFYEISLS
CCCCCCCCEEEEECCEEEECCCCCCCEEEEEECCCCCEEEEEEEEHHHHCCCCEEEEEEC
DDPLQVQSGETITITARLGNRERSLTHEVQPGSQQVDIVLPRRSPNDFVALQSIPLRSIS
CCCEEEECCCEEEEEEECCCCCCCCEECCCCCCCEEEEEECCCCCCCEEEEECCCCHHCC
GEFDGLSGIAINPEYQVFVVDQEAHQIQAFDTNGNPLQPPWGHYGQNPGQFNLPRRVVVD
CCCCCCCEEEECCCEEEEEEECCCCEEEEECCCCCCCCCCCCCCCCCCCCCCCCEEEEEE
ASRNVYILDAGNRRIQKFDRQGRYVHSWMLCTQLSSCPFPYDLALAPDGTIAVVYNQGVT
CCCCEEEEECCCHHHHHHHHCCCEEEEHHHHHHHCCCCCCEEEEECCCCCEEEEEECCEE
IFSTTGDLQRQWSTGIHGTDIDIDRNGNVYITTGQSDIYTFTPGGQLTTTLNTPLTSIQS
EEECCCHHHHHHCCCCCCCEEEEECCCCEEEEECCCCEEEECCCCEEEEEECCCHHHHHH
MAIDPSGNLWVTDPINGIVRLSTTGAIAQQWTIPGELFNDMAIAPNGQLYLTSYTNKVLV
EEECCCCCEEEECCCCCEEEEEECCCEEEEECCCHHHHCCEEECCCCCEEEEECCCEEEE
FDPTRGTTRSWGRSSRYRDVIGTVTVPNNTLFIANREPAAVTRLTFQQSVTSTQVALNPL
EECCCCCCCCCCCCCCCCEEEEEEEECCCEEEEECCCCCEEEEEEHHHCCCCCEEEECCC
PRRIVDMTKAADGSVYILDQSSSTTARVYKINALGQQLFSFPINDVSAGAIAVAQNGTIF
CHHHHHHHHCCCCEEEEEECCCCCEEEEEEEHHHHHHHHHCCCCCCCCCEEEEECCCEEE
IAEDLDNQVLQFSADGQYRSSWGGTGSKPGRFYLPSDLVIDSNGYIYVADRGNERIQKLR
EEECCCCCEEEEECCCCCCCCCCCCCCCCCEEECCCCEEECCCCEEEEEECCCHHHHEEE
LDGTVERTVSATFDPTLDNVLQVFNNNIYIYREDAIRVRDSDLTSPPLYTIELNNQVKGW
CCCCEEEEEEECCCCCHHHHHHHHCCCEEEEECCCEEEECCCCCCCCEEEEEECCCCCCC
DIDQHGNIYAFNPDTRQIEIYRPMRFTQPIATISYLNLSSLSADDTLIVQGMGQDSDETN
CCCCCCCEEEECCCCCEEEEECCCCCCCCHHEEEEEEECCCCCCCEEEEEECCCCCCCCC
TIHAWRWESNQNGQISTSRTLAIPAASLSSGTHTITLKVQDNEGEWSQQTSLSVYVSPRI
CEEEEEECCCCCCEEECCEEEEEECCCCCCCCEEEEEEEECCCCCCCCCCEEEEEECCCC
QNIPAWTILLYLDADYAADGQALLKSFNNTIRNLKQLSNSSIRIAIQIDGPQNNDTRRIL
CCCCEEEEEEEEECCCCCCHHHHHHHHHHHHHHHHHHCCCCEEEEEEECCCCCCCCEEEE
IHPGQPPSENSISEQAMDDPLTLANFLRWGQETFPARHYYLAIANHGQGVQGIAWDSTSD
EECCCCCCCCCCHHHHCCCHHHHHHHHHCCHHCCCCEEEEEEEECCCCCCCEEEECCCCC
ARDDGRRNNSAYLTIKELGQALNAPGVAPIDVIHLDACSMGLLEVAFELRPRSEVPLRSR
CCCCCCCCCCEEEEHHHHHHHHCCCCCCEEEEEEECCCCCCHHHHHHHCCCCCCCCHHHH
LLIASQYLGWSFFAYDEYVADITATSTPEMVARTVVQIYADKSVQKRVPFTITALDLGRV
EEEEHHHCCEEEEEHHHHHHEEECCCCHHHHHHHHHHHHCCCCHHCCCCEEEEEECCCCH
TTVASTVDRLAAELAAYANNSNEHFNQVQNIRNSSSHLNSDNDYRNARSDAYVDLLSWTR
HHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHCCCHHCCCCCCCCCCCCCHHHHHHHHHHH
NVRDSISDRAIQQRADELINELTGTQSFILPNPNGHRVGIATLPARYGSYRIDLSDVHGI
HHHHHHHHHHHHHHHHHHHHHHCCCCEEEEECCCCCEEEEEEECCCCCCEEEEECCCCEE
SIYYPDYTRRNATFNSYVNNYLFEFTRYTRWSELLTAGVVALNPGDPEVDEGLAPLAPLS
EEECCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCEEEECCCCCCHHCCCCCCCCCE
VEYYVHVPMIVR
EEEEEEEEEEEC
>Mature Secondary Structure 
AASCIRSMLLGGLFILLVSFNAPVFSMPILHSSPLTSGANQAGDTQESGAIPLPRGCGG
HHHHHHHHHHHHHHHHHHHCCCCEEEECCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC
VTPPGEVETTCCLNGIVYVDGEPVAGAEITITSSRGTSISLYTRYINTVDNVPFYEISLS
CCCCCCCCEEEEECCEEEECCCCCCCEEEEEECCCCCEEEEEEEEHHHHCCCCEEEEEEC
DDPLQVQSGETITITARLGNRERSLTHEVQPGSQQVDIVLPRRSPNDFVALQSIPLRSIS
CCCEEEECCCEEEEEEECCCCCCCCEECCCCCCCEEEEEECCCCCCCEEEEECCCCHHCC
GEFDGLSGIAINPEYQVFVVDQEAHQIQAFDTNGNPLQPPWGHYGQNPGQFNLPRRVVVD
CCCCCCCEEEECCCEEEEEEECCCCEEEEECCCCCCCCCCCCCCCCCCCCCCCCEEEEEE
ASRNVYILDAGNRRIQKFDRQGRYVHSWMLCTQLSSCPFPYDLALAPDGTIAVVYNQGVT
CCCCEEEEECCCHHHHHHHHCCCEEEEHHHHHHHCCCCCCEEEEECCCCCEEEEEECCEE
IFSTTGDLQRQWSTGIHGTDIDIDRNGNVYITTGQSDIYTFTPGGQLTTTLNTPLTSIQS
EEECCCHHHHHHCCCCCCCEEEEECCCCEEEEECCCCEEEECCCCEEEEEECCCHHHHHH
MAIDPSGNLWVTDPINGIVRLSTTGAIAQQWTIPGELFNDMAIAPNGQLYLTSYTNKVLV
EEECCCCCEEEECCCCCEEEEEECCCEEEEECCCHHHHCCEEECCCCCEEEEECCCEEEE
FDPTRGTTRSWGRSSRYRDVIGTVTVPNNTLFIANREPAAVTRLTFQQSVTSTQVALNPL
EECCCCCCCCCCCCCCCCEEEEEEEECCCEEEEECCCCCEEEEEEHHHCCCCCEEEECCC
PRRIVDMTKAADGSVYILDQSSSTTARVYKINALGQQLFSFPINDVSAGAIAVAQNGTIF
CHHHHHHHHCCCCEEEEEECCCCCEEEEEEEHHHHHHHHHCCCCCCCCCEEEEECCCEEE
IAEDLDNQVLQFSADGQYRSSWGGTGSKPGRFYLPSDLVIDSNGYIYVADRGNERIQKLR
EEECCCCCEEEEECCCCCCCCCCCCCCCCCEEECCCCEEECCCCEEEEEECCCHHHHEEE
LDGTVERTVSATFDPTLDNVLQVFNNNIYIYREDAIRVRDSDLTSPPLYTIELNNQVKGW
CCCCEEEEEEECCCCCHHHHHHHHCCCEEEEECCCEEEECCCCCCCCEEEEEECCCCCCC
DIDQHGNIYAFNPDTRQIEIYRPMRFTQPIATISYLNLSSLSADDTLIVQGMGQDSDETN
CCCCCCCEEEECCCCCEEEEECCCCCCCCHHEEEEEEECCCCCCCEEEEEECCCCCCCCC
TIHAWRWESNQNGQISTSRTLAIPAASLSSGTHTITLKVQDNEGEWSQQTSLSVYVSPRI
CEEEEEECCCCCCEEECCEEEEEECCCCCCCCEEEEEEEECCCCCCCCCCEEEEEECCCC
QNIPAWTILLYLDADYAADGQALLKSFNNTIRNLKQLSNSSIRIAIQIDGPQNNDTRRIL
CCCCEEEEEEEEECCCCCCHHHHHHHHHHHHHHHHHHCCCCEEEEEEECCCCCCCCEEEE
IHPGQPPSENSISEQAMDDPLTLANFLRWGQETFPARHYYLAIANHGQGVQGIAWDSTSD
EECCCCCCCCCCHHHHCCCHHHHHHHHHCCHHCCCCEEEEEEEECCCCCCCEEEECCCCC
ARDDGRRNNSAYLTIKELGQALNAPGVAPIDVIHLDACSMGLLEVAFELRPRSEVPLRSR
CCCCCCCCCCEEEEHHHHHHHHCCCCCCEEEEEEECCCCCCHHHHHHHCCCCCCCCHHHH
LLIASQYLGWSFFAYDEYVADITATSTPEMVARTVVQIYADKSVQKRVPFTITALDLGRV
EEEEHHHCCEEEEEHHHHHHEEECCCCHHHHHHHHHHHHCCCCHHCCCCEEEEEECCCCH
TTVASTVDRLAAELAAYANNSNEHFNQVQNIRNSSSHLNSDNDYRNARSDAYVDLLSWTR
HHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHCCCHHCCCCCCCCCCCCCHHHHHHHHHHH
NVRDSISDRAIQQRADELINELTGTQSFILPNPNGHRVGIATLPARYGSYRIDLSDVHGI
HHHHHHHHHHHHHHHHHHHHHHCCCCEEEEECCCCCEEEEEEECCCCCCEEEEECCCCEE
SIYYPDYTRRNATFNSYVNNYLFEFTRYTRWSELLTAGVVALNPGDPEVDEGLAPLAPLS
EEECCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCEEEECCCCCCHHCCCCCCCCCE
VEYYVHVPMIVR
EEEEEEEEEEEC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA