The gene/protein map for NC_010380 is currently unavailable.
Definition Streptococcus pneumoniae Hungary19A-6, complete genome.
Accession NC_010380
Length 2,245,615

Click here to switch to the map view.

The map label for this gene is polC [H]

Identifier: 169833032

GI number: 169833032

Start: 341140

End: 345531

Strand: Direct

Name: polC [H]

Synonym: SPH_0390

Alternate gene names: 169833032

Gene position: 341140-345531 (Clockwise)

Preceding gene: 169832443

Following gene: 169834473

Centisome position: 15.19

GC content: 44.74

Gene sequence:

>4392_bases
ATGTCAAATAGTTTTGAAATTTTGATGAATCAATTGGGGATGCCTGCTGAAATGAGACAGGCTCCTGCTTTAGCACAGGC
CGATATTGAGCGAGTTGTGGTCCATAAAATTAGTAAGGTATGGGAATTTCATTTCGTATTTTCTAATATTTTACCGATTG
AAATCTTTTTAGAAATAAAGAAAGGTTTGAGCGAGGAATTTTCTAAGACAGGTAATAAAGCAATTTTTGAAATCAAGGCT
CTGTCTCAAGAATTTTCAAACCAACTCTTGCAGGCCTATTATAGAGAGGCTTTTTCTGAAGGGCCATGTGCTAGTCAAGG
TTTTAAGTCCCTTTATCAGAATTTGCGAGTTCGTGCGGAGGGAAATCAGCTCTTTATTGAAGGCTCTGAGGCGATTGATA
AGGAACATTTTAAGAAGAATCATCTACCTAATTTAACCAAACAACTTGAAAAGTTTGGCTTTCCAACTTTTAACTGTCAA
GTAGAGAAAAATGATGTGCTGACTCAAGAGCAGGAAGAAGCCTTTCATTCTGAAAATGAGCAGATTGTTCAAGCTGCCAA
TGAGGAAGCGCTCCGTGCTATGGAACAACTGGAACAGATGGCACCTCCTCCAGCGGAAGAGAAACCAGCCTTTGATTTTC
AGGCCAAAAAAGCTGAAGCTAAACCAAAGCTGGACAAGGCGGAGATTACTCCTATGATCGAAGTCACGACGGAGGAAAAT
CGTCTGGTCTTTGAAGGGGTTGTGTTTGATGTGGAGCAAAAAGTGACCAGAACGGGTCGTGTTTTAATCAACTTTAAAAT
GACGGACTACACTTCAAGTTTTTCTATGCAAAAGTGGGTTAAAAATGAGGAAGAGGCTCAGAAATTTGACCTCATCAAGA
AGAATTCTTGGCTCCGAGTTCGTGGGAATGTAGAGATGAATAACTTCACACGCGATTTGACTATGAATGTGCAGGATGTG
CAGGAAGTTGTTCACTATGAGCGGAAGGATTTGATGCCAGAAGGTGACCGCCGGGTTGAGTTTCATGCTCATACTAACAT
GTCGACCATGGATGCTCTACCAGAGGTTGAAGAAATCGTTGCGACAGCTACTAAGTGGGGACACAAGGCGGTTGCTATAA
CGGATCATGGGAATGTTCAGTCCTTCCCACATGGCTATAAGGCGGCTAAGAAAGCGGGAATTCAGCTAATCTATGGAATG
GAAGCCAATATCGTGGAGGACCGTGTCCCTATCGTCTATAACGAAGTGGAGAGGGACTTGTCAGAAGCGACCTATGTGGT
TTTTGACGTGGAAACAACGGGTCTATCAGCCATCTATAATGATTTGATTCAGGTTGCAGCCTCTAAGATGTATAAGGGGA
ATGTCATTGCTGAATTTGATGAATTTATCAATCCCGGGCATCCTTTGTCGGCCTTTACCACGGAGTTGACTGGAATTACA
GATGATCATGTCAAAAATGCCAAACCACTAGAACAAGTTTTGCAAGAATTCCAAGAATTTTGCAAGGATACGGTCCTAGT
TGCTCACAATGCGACCTTTGACGTTGGCTTTATGAATGCCAATTATGAGCGTCATGGTCTGCCAAAGATTAGTCAGCCAG
TTATTGATACGCTAGAGTTTGCAAGAAACCTCTACCCTGAGTATAAGCGTCATGGTTTGGGACCGTTGACCAAGCGCTTT
GGTGTGGCTCTAGAACATCACCACATGGCCAATTACGATGCGGAAGCTACAGGTCGCCTGCTTTTCATCTTTATCAAAGA
GGTGGCAGAAAAACATGGTGTGACCGATTTAGCTAGACTCAACATTGATTTGATTAGTCCAGATTCTTATAAAAAAGCTC
GGATTAAGCATGCGACCATTTATGTCAAGAATCAGGTGGGGCTAAAAAATATCTTTAAACTGGTTTCTTTATCCAATACC
AAGTACTTTGAAGGGGTGCCACGAATTCCGAGAACGGTTTTAGATGCCCATCGGGAGGGTTTGATTTTAGGCTCAGCCTG
TGCAGAAGGTGAAGTTTTTGATGCGGTTGTTTCCCAAGGTGTGGATGCGGCGGTTGAGGTGGCCAAGTATTATGACTTTA
TCGAGGTCATGCCACCAGCTATCTATGCTCCCTTGATTGCTAAGGAGCAGGTCAAGGATATGGAAGAACTCCAGACCATT
ATCAAGAATTTGATAGAGGTCGGCGACCGTCTTGGCAAGCCCGTTTTGGCTACGGGAAATGTCCACTATATCGAACCAGA
AGAAGAGATTTACCGTGAAATTATCGTCCGCAGTTTGGGCCAAGGAGCTATGATTAACCGAACTATCGGTCATGGTGAAC
ATGCCCAACCGGCACCGCTTCCAAAGGCTCATTTTAGAACGACTAATGAGATGTTGGATGAATTTGCCTTCTTGGGAGAG
GAATTAGCTCGCAAATTGGTTATTGAAAACACCAATGCCTTGGCAGATATCTTTGAACCTGTTGAGGTTGTTAAGGGGGA
CTTGTATACGCCTTTCATCGACAAGGCTGAAGAAACAGTTGCCGAGTTGACCTATAAGAAAGCTTTTGAGATTTATGGAA
ATCCGCTGCCAGATATCGTTGATTTGCGGATTGAAAAAGAACTAACCTCTATTCTGGGGAATGGATTTGCCGTGATTTAT
CTGGCTTCCCAGATGCTAGTGCAACGTTCTAATGAACGGGGTTACCTGGTGGGTTCTCGTGGTTCTGTCGGATCTAGTTT
CGTTGCGACCATGATTGGGATTACGGAGGTTAATCCTCTATCTCCTCACTATGTCTGTGGTCAGTGTCAGTACAGCGAAT
TTATCACCGATGGTTCTTATGGTTCAGGTTTTGATATGCCCAATAAGGACTGTCCTAAATGTGGTCACAAACTAAGTAAA
AACGGACAGGATATTCCTTTCGAGACCTTCCTTGGTTTTGATGGAGATAAGGTTCCCGATATTGACTTGAACTTCTCGGG
AGAAGACCAGCCTAGCGCCCACTTGGATGTGCGTGATATCTTTGGTGAGGAATATGCCTTCCGTGCAGGAACGGTTGGTA
CGGTGGCTGCCAAGACTGCCTATGGATTTGTCAAGGGTTACGAGCGAGATTATGGTAAGTTTTATCGTGATGCAGAGGTA
GAACGCCTCGCTCAAGGTGCAGCTGGTGTCAAGCGGACGACAGGCCAACACCCGGGGGGAATCGTTGTTATTCCGAACTA
CATGGATGTCTATGATTTCACGCCTGTTCAGTATCCAGCGGATGACGTGACGGCTGAATGGCAGACCACTCACTTTAACT
TCCATGATATAGACGAGAACGTCCTCAAACTCGATGTACTGGGACATGATGATCCGACCATGATTCGGAAACTGCAGGAT
TTGTCAGGGATTGATCCTAATGAAATTCCTATGGATGATGAAGGTGTGATGGCCCTCTTTTCTGGGACGGATGTGCTAGG
GGTAACCCCTGAACAAATCGGAACGCCGACAGGTATGCTGGGGATTCCAGAATTTGGAACCAACTTTGTACGTGGGATGG
TAGATGAGACGCATCCGACGACTTTTGCGGAGTTGCTTCAGCTCTCAGGTCTGTCCCACGGTACCGATGTCTGGTTGGGC
AATGCCCAGGATTTGATTAAGCAAGGGATTGCGGATCTGTCGACCGTTATCGGTTGTCGGGACGACATCATGGTTTACCT
CATGCATGCTGGTCTTGAACCTAAGATGGCCTTTACCATTATGGAACGGGTACGTAAGGGCTTGTGGCTCAAGATTTCCG
AAGAGGAACGCAATGGCTATATCGAAGCCATGAAAGCTAATAAGGTGCCAGAGTGGTATATCGAGTCCTGTGGGAAAATT
AAGTACATGTTTCCTAAAGCCCATGCGGCAGCCTACGTTATGATGGCCTTGCGTGTGGCCTACTTCAAGGTTCACCATCC
CATTTATTATTACTGTGCTTACTTCTCCATTCGTGCTAAGGCTTTTGACATCAAGACCATGGGAGCGGGCTTGGATGCTA
TCAAGCATAGAATGGAAGAAATCTCTGAAAAACGGAAGAACAATGAAGCCTCTAATGTGGAAATTGATCTCTATACAACT
CTTGAGATTGTCAATGAGATGTGGGAACGAGGTTTCAAGTTTGGAAAACTCGATCTCTACCGTAGTCAGGCGACAGAGTT
CCTTATCGATGGGGATACCCTCATTCCGCCATTTGTAGCAATGGATGGTCTGGGAGAGAACGTTGCTAAGCAGTTAGTTC
GAGCGCGTGAAGAGGGAGAATTCCTGTCTAAAACAGAACTACGCAAACGTGGTGGGCTCTCATCAACCTTGGTTGAAAAG
ATGGATGAAATGGGTATTCTTGGAAATATGCCAGAGGATAACCAGTTGAGTTTGTTTGATGAGTTGTTTTAA

Upstream 100 bases:

>100_bases
GTCCTACCTCTAGAAGGAAGTCACTTAGTGGCTTCCTTTTGTCTTTAGAAAACACCTCTAAGTATGGTAAAATAGTAGGA
GAATAATGTGAGGAAAATGA

Downstream 100 bases:

>100_bases
AAAATTGCTTAATAATCTATTAAAAGAGGCTAACGTATATCCAATAGATTTACATTAGCTTTCTTTTTTGTTAAAATAGT
CTATGGAAAGAGGGTGAGAG

Product: DNA polymerase III PolC

Products: NA

Alternate protein names: PolIII [H]

Number of amino acids: Translated: 1463; Mature: 1462

Protein sequence:

>1463_residues
MSNSFEILMNQLGMPAEMRQAPALAQADIERVVVHKISKVWEFHFVFSNILPIEIFLEIKKGLSEEFSKTGNKAIFEIKA
LSQEFSNQLLQAYYREAFSEGPCASQGFKSLYQNLRVRAEGNQLFIEGSEAIDKEHFKKNHLPNLTKQLEKFGFPTFNCQ
VEKNDVLTQEQEEAFHSENEQIVQAANEEALRAMEQLEQMAPPPAEEKPAFDFQAKKAEAKPKLDKAEITPMIEVTTEEN
RLVFEGVVFDVEQKVTRTGRVLINFKMTDYTSSFSMQKWVKNEEEAQKFDLIKKNSWLRVRGNVEMNNFTRDLTMNVQDV
QEVVHYERKDLMPEGDRRVEFHAHTNMSTMDALPEVEEIVATATKWGHKAVAITDHGNVQSFPHGYKAAKKAGIQLIYGM
EANIVEDRVPIVYNEVERDLSEATYVVFDVETTGLSAIYNDLIQVAASKMYKGNVIAEFDEFINPGHPLSAFTTELTGIT
DDHVKNAKPLEQVLQEFQEFCKDTVLVAHNATFDVGFMNANYERHGLPKISQPVIDTLEFARNLYPEYKRHGLGPLTKRF
GVALEHHHMANYDAEATGRLLFIFIKEVAEKHGVTDLARLNIDLISPDSYKKARIKHATIYVKNQVGLKNIFKLVSLSNT
KYFEGVPRIPRTVLDAHREGLILGSACAEGEVFDAVVSQGVDAAVEVAKYYDFIEVMPPAIYAPLIAKEQVKDMEELQTI
IKNLIEVGDRLGKPVLATGNVHYIEPEEEIYREIIVRSLGQGAMINRTIGHGEHAQPAPLPKAHFRTTNEMLDEFAFLGE
ELARKLVIENTNALADIFEPVEVVKGDLYTPFIDKAEETVAELTYKKAFEIYGNPLPDIVDLRIEKELTSILGNGFAVIY
LASQMLVQRSNERGYLVGSRGSVGSSFVATMIGITEVNPLSPHYVCGQCQYSEFITDGSYGSGFDMPNKDCPKCGHKLSK
NGQDIPFETFLGFDGDKVPDIDLNFSGEDQPSAHLDVRDIFGEEYAFRAGTVGTVAAKTAYGFVKGYERDYGKFYRDAEV
ERLAQGAAGVKRTTGQHPGGIVVIPNYMDVYDFTPVQYPADDVTAEWQTTHFNFHDIDENVLKLDVLGHDDPTMIRKLQD
LSGIDPNEIPMDDEGVMALFSGTDVLGVTPEQIGTPTGMLGIPEFGTNFVRGMVDETHPTTFAELLQLSGLSHGTDVWLG
NAQDLIKQGIADLSTVIGCRDDIMVYLMHAGLEPKMAFTIMERVRKGLWLKISEEERNGYIEAMKANKVPEWYIESCGKI
KYMFPKAHAAAYVMMALRVAYFKVHHPIYYYCAYFSIRAKAFDIKTMGAGLDAIKHRMEEISEKRKNNEASNVEIDLYTT
LEIVNEMWERGFKFGKLDLYRSQATEFLIDGDTLIPPFVAMDGLGENVAKQLVRAREEGEFLSKTELRKRGGLSSTLVEK
MDEMGILGNMPEDNQLSLFDELF

Sequences:

>Translated_1463_residues
MSNSFEILMNQLGMPAEMRQAPALAQADIERVVVHKISKVWEFHFVFSNILPIEIFLEIKKGLSEEFSKTGNKAIFEIKA
LSQEFSNQLLQAYYREAFSEGPCASQGFKSLYQNLRVRAEGNQLFIEGSEAIDKEHFKKNHLPNLTKQLEKFGFPTFNCQ
VEKNDVLTQEQEEAFHSENEQIVQAANEEALRAMEQLEQMAPPPAEEKPAFDFQAKKAEAKPKLDKAEITPMIEVTTEEN
RLVFEGVVFDVEQKVTRTGRVLINFKMTDYTSSFSMQKWVKNEEEAQKFDLIKKNSWLRVRGNVEMNNFTRDLTMNVQDV
QEVVHYERKDLMPEGDRRVEFHAHTNMSTMDALPEVEEIVATATKWGHKAVAITDHGNVQSFPHGYKAAKKAGIQLIYGM
EANIVEDRVPIVYNEVERDLSEATYVVFDVETTGLSAIYNDLIQVAASKMYKGNVIAEFDEFINPGHPLSAFTTELTGIT
DDHVKNAKPLEQVLQEFQEFCKDTVLVAHNATFDVGFMNANYERHGLPKISQPVIDTLEFARNLYPEYKRHGLGPLTKRF
GVALEHHHMANYDAEATGRLLFIFIKEVAEKHGVTDLARLNIDLISPDSYKKARIKHATIYVKNQVGLKNIFKLVSLSNT
KYFEGVPRIPRTVLDAHREGLILGSACAEGEVFDAVVSQGVDAAVEVAKYYDFIEVMPPAIYAPLIAKEQVKDMEELQTI
IKNLIEVGDRLGKPVLATGNVHYIEPEEEIYREIIVRSLGQGAMINRTIGHGEHAQPAPLPKAHFRTTNEMLDEFAFLGE
ELARKLVIENTNALADIFEPVEVVKGDLYTPFIDKAEETVAELTYKKAFEIYGNPLPDIVDLRIEKELTSILGNGFAVIY
LASQMLVQRSNERGYLVGSRGSVGSSFVATMIGITEVNPLSPHYVCGQCQYSEFITDGSYGSGFDMPNKDCPKCGHKLSK
NGQDIPFETFLGFDGDKVPDIDLNFSGEDQPSAHLDVRDIFGEEYAFRAGTVGTVAAKTAYGFVKGYERDYGKFYRDAEV
ERLAQGAAGVKRTTGQHPGGIVVIPNYMDVYDFTPVQYPADDVTAEWQTTHFNFHDIDENVLKLDVLGHDDPTMIRKLQD
LSGIDPNEIPMDDEGVMALFSGTDVLGVTPEQIGTPTGMLGIPEFGTNFVRGMVDETHPTTFAELLQLSGLSHGTDVWLG
NAQDLIKQGIADLSTVIGCRDDIMVYLMHAGLEPKMAFTIMERVRKGLWLKISEEERNGYIEAMKANKVPEWYIESCGKI
KYMFPKAHAAAYVMMALRVAYFKVHHPIYYYCAYFSIRAKAFDIKTMGAGLDAIKHRMEEISEKRKNNEASNVEIDLYTT
LEIVNEMWERGFKFGKLDLYRSQATEFLIDGDTLIPPFVAMDGLGENVAKQLVRAREEGEFLSKTELRKRGGLSSTLVEK
MDEMGILGNMPEDNQLSLFDELF
>Mature_1462_residues
SNSFEILMNQLGMPAEMRQAPALAQADIERVVVHKISKVWEFHFVFSNILPIEIFLEIKKGLSEEFSKTGNKAIFEIKAL
SQEFSNQLLQAYYREAFSEGPCASQGFKSLYQNLRVRAEGNQLFIEGSEAIDKEHFKKNHLPNLTKQLEKFGFPTFNCQV
EKNDVLTQEQEEAFHSENEQIVQAANEEALRAMEQLEQMAPPPAEEKPAFDFQAKKAEAKPKLDKAEITPMIEVTTEENR
LVFEGVVFDVEQKVTRTGRVLINFKMTDYTSSFSMQKWVKNEEEAQKFDLIKKNSWLRVRGNVEMNNFTRDLTMNVQDVQ
EVVHYERKDLMPEGDRRVEFHAHTNMSTMDALPEVEEIVATATKWGHKAVAITDHGNVQSFPHGYKAAKKAGIQLIYGME
ANIVEDRVPIVYNEVERDLSEATYVVFDVETTGLSAIYNDLIQVAASKMYKGNVIAEFDEFINPGHPLSAFTTELTGITD
DHVKNAKPLEQVLQEFQEFCKDTVLVAHNATFDVGFMNANYERHGLPKISQPVIDTLEFARNLYPEYKRHGLGPLTKRFG
VALEHHHMANYDAEATGRLLFIFIKEVAEKHGVTDLARLNIDLISPDSYKKARIKHATIYVKNQVGLKNIFKLVSLSNTK
YFEGVPRIPRTVLDAHREGLILGSACAEGEVFDAVVSQGVDAAVEVAKYYDFIEVMPPAIYAPLIAKEQVKDMEELQTII
KNLIEVGDRLGKPVLATGNVHYIEPEEEIYREIIVRSLGQGAMINRTIGHGEHAQPAPLPKAHFRTTNEMLDEFAFLGEE
LARKLVIENTNALADIFEPVEVVKGDLYTPFIDKAEETVAELTYKKAFEIYGNPLPDIVDLRIEKELTSILGNGFAVIYL
ASQMLVQRSNERGYLVGSRGSVGSSFVATMIGITEVNPLSPHYVCGQCQYSEFITDGSYGSGFDMPNKDCPKCGHKLSKN
GQDIPFETFLGFDGDKVPDIDLNFSGEDQPSAHLDVRDIFGEEYAFRAGTVGTVAAKTAYGFVKGYERDYGKFYRDAEVE
RLAQGAAGVKRTTGQHPGGIVVIPNYMDVYDFTPVQYPADDVTAEWQTTHFNFHDIDENVLKLDVLGHDDPTMIRKLQDL
SGIDPNEIPMDDEGVMALFSGTDVLGVTPEQIGTPTGMLGIPEFGTNFVRGMVDETHPTTFAELLQLSGLSHGTDVWLGN
AQDLIKQGIADLSTVIGCRDDIMVYLMHAGLEPKMAFTIMERVRKGLWLKISEEERNGYIEAMKANKVPEWYIESCGKIK
YMFPKAHAAAYVMMALRVAYFKVHHPIYYYCAYFSIRAKAFDIKTMGAGLDAIKHRMEEISEKRKNNEASNVEIDLYTTL
EIVNEMWERGFKFGKLDLYRSQATEFLIDGDTLIPPFVAMDGLGENVAKQLVRAREEGEFLSKTELRKRGGLSSTLVEKM
DEMGILGNMPEDNQLSLFDELF

Specific function: Required for replicative DNA synthesis. This DNA polymerase also exhibits 3' to 5' exonuclease activity [H]

COG id: COG2176

COG function: function code L; DNA polymerase III, alpha subunit (gram-positive type)

Gene ontology:

Cell location: Cytoplasm [H]

Metaboloic importance: Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 exonuclease domain [H]

Homologues:

Organism=Escherichia coli, GI1786381, Length=928, Percent_Identity=22.7370689655172, Blast_Score=107, Evalue=4e-24,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR011708
- InterPro:   IPR006054
- InterPro:   IPR006055
- InterPro:   IPR013520
- InterPro:   IPR012340
- InterPro:   IPR016027
- InterPro:   IPR004013
- InterPro:   IPR003141
- InterPro:   IPR016195
- InterPro:   IPR006308
- InterPro:   IPR012337 [H]

Pfam domain/function: PF07733 DNA_pol3_alpha; PF00929 Exonuc_X-T; PF02811 PHP [H]

EC number: =2.7.7.7 [H]

Molecular weight: Translated: 164762; Mature: 164631

Theoretical pI: Translated: 4.84; Mature: 4.84

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.8 %Cys     (Translated Protein)
3.1 %Met     (Translated Protein)
3.9 %Cys+Met (Translated Protein)
0.8 %Cys     (Mature Protein)
3.1 %Met     (Mature Protein)
3.8 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSNSFEILMNQLGMPAEMRQAPALAQADIERVVVHKISKVWEFHFVFSNILPIEIFLEIK
CCCHHHHHHHHCCCCHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHH
KGLSEEFSKTGNKAIFEIKALSQEFSNQLLQAYYREAFSEGPCASQGFKSLYQNLRVRAE
HHHHHHHHHCCCCEEEHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHCEEEEC
GNQLFIEGSEAIDKEHFKKNHLPNLTKQLEKFGFPTFNCQVEKNDVLTQEQEEAFHSENE
CCEEEEECHHHHHHHHHHHCCCCHHHHHHHHHCCCCEEEEECCCCCCCCHHHHHHHCCCH
QIVQAANEEALRAMEQLEQMAPPPAEEKPAFDFQAKKAEAKPKLDKAEITPMIEVTTEEN
HHHHHCCHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCHHHCCEEEEEECCCC
RLVFEGVVFDVEQKVTRTGRVLINFKMTDYTSSFSMQKWVKNEEEAQKFDLIKKNSWLRV
EEEEEHEEHHHHHHHHCCCEEEEEEEEECCCCCHHHHHHHCCHHHHHHHHHHCCCCEEEE
RGNVEMNNFTRDLTMNVQDVQEVVHYERKDLMPEGDRRVEFHAHTNMSTMDALPEVEEIV
ECCEECCCCCHHHCCCHHHHHHHHHHHHHHCCCCCCCEEEEEECCCCHHHHHCHHHHHHH
ATATKWGHKAVAITDHGNVQSFPHGYKAAKKAGIQLIYGMEANIVEDRVPIVYNEVERDL
HHHHHCCCEEEEEECCCCCCCCCCHHHHHHHCCCEEEECCCCCHHCCCCCHHHHHHHHHH
SEATYVVFDVETTGLSAIYNDLIQVAASKMYKGNVIAEFDEFINPGHPLSAFTTELTGIT
HHCEEEEEEECCCCHHHHHHHHHHHHHHHHHCCCCHHHHHHHCCCCCCHHHHHHHHCCCC
DDHVKNAKPLEQVLQEFQEFCKDTVLVAHNATFDVGFMNANYERHGLPKISQPVIDTLEF
HHHHCCCHHHHHHHHHHHHHHHCCEEEEECCEEEEEEECCCCHHCCCCCCHHHHHHHHHH
ARNLYPEYKRHGLGPLTKRFGVALEHHHMANYDAEATGRLLFIFIKEVAEKHGVTDLARL
HHHHCHHHHHCCCCHHHHHHCCHHHHHHCCCCCCCCCCCCHHHHHHHHHHHCCCCEEHHE
NIDLISPDSYKKARIKHATIYVKNQVGLKNIFKLVSLSNTKYFEGVPRIPRTVLDAHREG
EEEEECCCCHHHHHEEEEEEEEECCCCHHHHHHHHHCCCCHHHCCCCCCHHHHHHHHHCC
LILGSACAEGEVFDAVVSQGVDAAVEVAKYYDFIEVMPPAIYAPLIAKEQVKDMEELQTI
EEEECCCCCCHHHHHHHHCCCHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHH
IKNLIEVGDRLGKPVLATGNVHYIEPEEEIYREIIVRSLGQGAMINRTIGHGEHAQPAPL
HHHHHHHHHHHCCCEEECCCEEEECCHHHHHHHHHHHHCCCCCEEECCCCCCCCCCCCCC
PKAHFRTTNEMLDEFAFLGEELARKLVIENTNALADIFEPVEVVKGDLYTPFIDKAEETV
CHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHCCCCCCCHHHHHHHHH
AELTYKKAFEIYGNPLPDIVDLRIEKELTSILGNGFAVIYLASQMLVQRSNERGYLVGSR
HHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHCCCEEEHHHHHHHHHHCCCCCCEEEECC
GSVGSSFVATMIGITEVNPLSPHYVCGQCQYSEFITDGSYGSGFDMPNKDCPKCGHKLSK
CCCCHHHHHHHHHHHCCCCCCCCEEECCCCHHHHHCCCCCCCCCCCCCCCCCHHHHHHCC
NGQDIPFETFLGFDGDKVPDIDLNFSGEDQPSAHLDVRDIFGEEYAFRAGTVGTVAAKTA
CCCCCCHHHHCCCCCCCCCCEECCCCCCCCCCCCCCHHHHCCCHHEECCCCCHHHHHHHH
YGFVKGYERDYGKFYRDAEVERLAQGAAGVKRTTGQHPGGIVVIPNYMDVYDFTPVQYPA
HHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCEEEECCCCCCCCCCCCCCCC
DDVTAEWQTTHFNFHDIDENVLKLDVLGHDDPTMIRKLQDLSGIDPNEIPMDDEGVMALF
CCCCCCEEEEECCCCCCCCCEEEEEEECCCCHHHHHHHHHHCCCCCCCCCCCCCCCEEEE
SGTDVLGVTPEQIGTPTGMLGIPEFGTNFVRGMVDETHPTTFAELLQLSGLSHGTDVWLG
ECCCEECCCHHHHCCCCCCCCCCHHHHHHHHHHCCCCCCHHHHHHHHHCCCCCCCCEEEC
NAQDLIKQGIADLSTVIGCRDDIMVYLMHAGLEPKMAFTIMERVRKGLWLKISEEERNGY
CHHHHHHHHHHHHHHHHCCCHHHHHHHHHCCCCCHHHHHHHHHHHCCCEEEEECCCCCCE
IEAMKANKVPEWYIESCGKIKYMFPKAHAAAYVMMALRVAYFKVHHPIYYYCAYFSIRAK
EEEHHCCCCCHHHHHCCCCEEEECCHHHHHHHHHHHHHHHHHHHCCCCEEEHHHHHHHHE
AFDIKTMGAGLDAIKHRMEEISEKRKNNEASNVEIDLYTTLEIVNEMWERGFKFGKLDLY
EEEEHHHCCCHHHHHHHHHHHHHHHCCCCCCCEEEEEHHHHHHHHHHHHCCCCCCCHHHH
RSQATEFLIDGDTLIPPFVAMDGLGENVAKQLVRAREEGEFLSKTELRKRGGLSSTLVEK
HHHCCEEEECCCCCCCCHHHHCCCCHHHHHHHHHHHHCCCHHHHHHHHHHCCCHHHHHHH
MDEMGILGNMPEDNQLSLFDELF
HHHCCCCCCCCCCCCHHHHHHCC
>Mature Secondary Structure 
SNSFEILMNQLGMPAEMRQAPALAQADIERVVVHKISKVWEFHFVFSNILPIEIFLEIK
CCHHHHHHHHCCCCHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHH
KGLSEEFSKTGNKAIFEIKALSQEFSNQLLQAYYREAFSEGPCASQGFKSLYQNLRVRAE
HHHHHHHHHCCCCEEEHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHCEEEEC
GNQLFIEGSEAIDKEHFKKNHLPNLTKQLEKFGFPTFNCQVEKNDVLTQEQEEAFHSENE
CCEEEEECHHHHHHHHHHHCCCCHHHHHHHHHCCCCEEEEECCCCCCCCHHHHHHHCCCH
QIVQAANEEALRAMEQLEQMAPPPAEEKPAFDFQAKKAEAKPKLDKAEITPMIEVTTEEN
HHHHHCCHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCHHHCCEEEEEECCCC
RLVFEGVVFDVEQKVTRTGRVLINFKMTDYTSSFSMQKWVKNEEEAQKFDLIKKNSWLRV
EEEEEHEEHHHHHHHHCCCEEEEEEEEECCCCCHHHHHHHCCHHHHHHHHHHCCCCEEEE
RGNVEMNNFTRDLTMNVQDVQEVVHYERKDLMPEGDRRVEFHAHTNMSTMDALPEVEEIV
ECCEECCCCCHHHCCCHHHHHHHHHHHHHHCCCCCCCEEEEEECCCCHHHHHCHHHHHHH
ATATKWGHKAVAITDHGNVQSFPHGYKAAKKAGIQLIYGMEANIVEDRVPIVYNEVERDL
HHHHHCCCEEEEEECCCCCCCCCCHHHHHHHCCCEEEECCCCCHHCCCCCHHHHHHHHHH
SEATYVVFDVETTGLSAIYNDLIQVAASKMYKGNVIAEFDEFINPGHPLSAFTTELTGIT
HHCEEEEEEECCCCHHHHHHHHHHHHHHHHHCCCCHHHHHHHCCCCCCHHHHHHHHCCCC
DDHVKNAKPLEQVLQEFQEFCKDTVLVAHNATFDVGFMNANYERHGLPKISQPVIDTLEF
HHHHCCCHHHHHHHHHHHHHHHCCEEEEECCEEEEEEECCCCHHCCCCCCHHHHHHHHHH
ARNLYPEYKRHGLGPLTKRFGVALEHHHMANYDAEATGRLLFIFIKEVAEKHGVTDLARL
HHHHCHHHHHCCCCHHHHHHCCHHHHHHCCCCCCCCCCCCHHHHHHHHHHHCCCCEEHHE
NIDLISPDSYKKARIKHATIYVKNQVGLKNIFKLVSLSNTKYFEGVPRIPRTVLDAHREG
EEEEECCCCHHHHHEEEEEEEEECCCCHHHHHHHHHCCCCHHHCCCCCCHHHHHHHHHCC
LILGSACAEGEVFDAVVSQGVDAAVEVAKYYDFIEVMPPAIYAPLIAKEQVKDMEELQTI
EEEECCCCCCHHHHHHHHCCCHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHH
IKNLIEVGDRLGKPVLATGNVHYIEPEEEIYREIIVRSLGQGAMINRTIGHGEHAQPAPL
HHHHHHHHHHHCCCEEECCCEEEECCHHHHHHHHHHHHCCCCCEEECCCCCCCCCCCCCC
PKAHFRTTNEMLDEFAFLGEELARKLVIENTNALADIFEPVEVVKGDLYTPFIDKAEETV
CHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHCCCCCCCHHHHHHHHH
AELTYKKAFEIYGNPLPDIVDLRIEKELTSILGNGFAVIYLASQMLVQRSNERGYLVGSR
HHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHCCCEEEHHHHHHHHHHCCCCCCEEEECC
GSVGSSFVATMIGITEVNPLSPHYVCGQCQYSEFITDGSYGSGFDMPNKDCPKCGHKLSK
CCCCHHHHHHHHHHHCCCCCCCCEEECCCCHHHHHCCCCCCCCCCCCCCCCCHHHHHHCC
NGQDIPFETFLGFDGDKVPDIDLNFSGEDQPSAHLDVRDIFGEEYAFRAGTVGTVAAKTA
CCCCCCHHHHCCCCCCCCCCEECCCCCCCCCCCCCCHHHHCCCHHEECCCCCHHHHHHHH
YGFVKGYERDYGKFYRDAEVERLAQGAAGVKRTTGQHPGGIVVIPNYMDVYDFTPVQYPA
HHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCEEEECCCCCCCCCCCCCCCC
DDVTAEWQTTHFNFHDIDENVLKLDVLGHDDPTMIRKLQDLSGIDPNEIPMDDEGVMALF
CCCCCCEEEEECCCCCCCCCEEEEEEECCCCHHHHHHHHHHCCCCCCCCCCCCCCCEEEE
SGTDVLGVTPEQIGTPTGMLGIPEFGTNFVRGMVDETHPTTFAELLQLSGLSHGTDVWLG
ECCCEECCCHHHHCCCCCCCCCCHHHHHHHHHHCCCCCCHHHHHHHHHCCCCCCCCEEEC
NAQDLIKQGIADLSTVIGCRDDIMVYLMHAGLEPKMAFTIMERVRKGLWLKISEEERNGY
CHHHHHHHHHHHHHHHHCCCHHHHHHHHHCCCCCHHHHHHHHHHHCCCEEEEECCCCCCE
IEAMKANKVPEWYIESCGKIKYMFPKAHAAAYVMMALRVAYFKVHHPIYYYCAYFSIRAK
EEEHHCCCCCHHHHHCCCCEEEECCHHHHHHHHHHHHHHHHHHHCCCCEEEHHHHHHHHE
AFDIKTMGAGLDAIKHRMEEISEKRKNNEASNVEIDLYTTLEIVNEMWERGFKFGKLDLY
EEEEHHHCCCHHHHHHHHHHHHHHHCCCCCCCEEEEEHHHHHHHHHHHHCCCCCCCHHHH
RSQATEFLIDGDTLIPPFVAMDGLGENVAKQLVRAREEGEFLSKTELRKRGGLSSTLVEK
HHHCCEEEECCCCCCCCHHHHCCCCHHHHHHHHHHHHCCCHHHHHHHHHHCCCHHHHHHH
MDEMGILGNMPEDNQLSLFDELF
HHHCCCCCCCCCCCCHHHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA