Definition Thermoanaerobacter tengcongensis MB4, complete genome.
Accession NC_003869
Length 2,689,445

Click here to switch to the map view.

The map label for this gene is polC

Identifier: 20807845

GI number: 20807845

Start: 1379781

End: 1383986

Strand: Reverse

Name: polC

Synonym: TTE1398

Alternate gene names: 20807845

Gene position: 1383986-1379781 (Counterclockwise)

Preceding gene: 20807846

Following gene: 20807844

Centisome position: 51.46

GC content: 39.61

Gene sequence:

>4206_bases
ATGGTTCCAGCGACTTTCTTGGAAAACATGCAAATAAAAAAAGTAAGAGTTGAAAAAAAGAGCCGAAAACTCACTGTGGT
TGTCTCCTCTTTCTCATCAAATGCACAAAAGCTCTCAGAATTTCAGTCTTTTTTGGAGGAAAGCTTTCCTTCTCTAAAGG
AGATAAAGATTGTGGTGGAAAGCCCTTCTTTATCAACAGTAGAAGAGGTTTTGGAAAACTGGGAGAAAGTAGTATTAGAG
CTTAGCGAAGAGTACCCTTCTTCCTTAAGTTTTTTAAAGACCTGTGATGTCGCAAAAGAGGGACAGAATAGGATAACTGT
AAAGGCTCCAACTTACGCAATTTACGAAATGGCTAAAAGCAGCAAATTAGATTTTGCAATAAGAGAATTTTTAAGGAACA
GGTATGAACTTAATTTAGATGTAGAACTTATTTTTTCAGAAGAAGGGGAAGAAATTGCAGAAAAAATAATCGAAGAAGAC
ATAAAAGCAATTGAGGAAGTTATCCAAAAAGATGAGAAGTCTAAAAAGGAGAAGAGTAGGTCTGAAGAAAATAGAGTTCT
CCTTGGCAAAGAAATGAAAGCTAAACCTATCTCTATTAAGGATGTAAGTGCAGAAACCGATGAGGTAGTGATTGAAGGAG
AAATATTTTCTATTGATTTTAAAGAGTTGAAGTCAAAAGTTCTCATGGTGTTTGACATTACAGATTATACTAGTTCAATA
CTTGTCAAAACCTTTTTGACAGAAGAAAAATATGAAATTTTGAAAGATGAAATAGATGTAGGAACTTTTGTCAGGTTAAG
AGGAAATGTGATATACGATAAGTACGAAGGAGACCTTGTAATTGATTTGAAAGACTTAGAGCTCATTCCTCCAAAAAAGA
GAATGGATTTGTCCGAAGAAAAGAGAGTGGAGCTTCACCTTCACACCCAGATGAGCACTTTAGATGCCGTCCCTTCTGCT
ACTGAAGTGATAAAGAGAGCGGCAGAATGGGGACACAAGGCTGTTGCAATAACAGACCACGCAGTGGTTCAAGCTTTTCC
AGAGGCAATGGAAGCATCTCGAGAGTATGGGGTTAAGGTTATATACGGAATGGAAGGGTATATGGTGGATGACGGAATAC
CAATTGTCACTGGAGAATCCGAAGCTAGTTTGGAAGGCGAATTTGTGGTATTTGATATCGAAACCACAGGCCTTTCAAAC
ATAAATGACGAGATAATAGAGATTGGTGCTGTCAAGATCAAAAACAAGAAAATAGTAGATACTTTTGAAACTTTTGTAAA
TCCTCAAATACCCATTTCTTCTTTCATCACAAAACTCACAGGAATCGATGAATCAATGGTTAAAGATGCTCCTTTAATAG
AAGAGGTGTTGCCTAAATTTTTGGAATTTGCAAAAGGAGCAGTTCTGGTAGCACACAATGCCAATTTTGATGTGTCCTTT
ATTAAATCAAAGGCTAAGAAACTAGGTTTGACTGTTGAAAACACTGTCTTAGATACGCTTGAGTTGAGCAGGCATCTGTA
CCAAGATCTTAAAAATTACAAACTCGACACTCTTGCTGAATTTTTTGAAGTAAAGCTTTTGCATCACCACAGGGCCGTGG
AAGACGCGAAGGCTACAGCAGAAATTTTCATTAAGATGCTAGAAAAGCTGCAAGAAATAGGCATAAAGAGTGTAAGCGAA
ATCAACTCGGTTTTGATGGAAAGGGAAGTGGACGTAAAAAAATTGCCTGTATACCATGTGACAATTTTGGTAAAGGACCA
GAAGGGTTTAAGGAATTTATACGAGATAATATCTAGGTCAAACCTGGAGTTTTTCCACCGCACCCCCAGAATACCAAAGA
GTCTGTTGGTGAAAATGAGAGAAGGGCTGATCATAGGGTCTGCCTGTGAGCAGGGAGAAGTGTTCAGAGCCTTGGTTTCT
AACTTGGAGGAAAAGAAGCTCGAAGATATAATCAACTTTTACGACTATTTGGAAATTCAGCCTGTGGGGAACAACGAATT
TTTGATTGAAAGAGGAGAGGTAAGAAGCGTAGAAGAACTTAAAGAAATAAACAGAAAGATATACGAACTTGGGAAAAAGT
ACAACAAGCTGGTAGTAGCAACAGGAGATGTGCATTTTTTAGACCCGTGGGACGATGTGTACAGAAAAATATTAATGGCG
GGCAAAGGGTATAAGGATGCGGACAGACAGCCTCCTCTTTACTTTAGGACAACTGAAGAAATGCTTATGGAGTTTGAATA
TCTAGGAGAAGAAGCTGCCAGAGAGGTAGTCATTGAAAATCCAAATAAAATTGCGGAAATTGTGGAAGATGTAAAGCCTA
TTCCTGAGGGAACTTTTCCGCCTGTCATCGAAGGGGCAGAAGAAGAATTAAGAAGGATTACCCTTGAAAAAGCTCATGAG
ATATACGGTGACCCATTGCCTCCAATTGTGCAGGAAAGGCTTGACAGAGAGCTAAACGCCATAATAAACAACGGTTACGC
TGTAATGTACGTAATAGCTCAGAAGCTAGTATCAAAGTCGCTGCAGGATGGATATTTGGTTGGTTCAAGAGGCTCTGTAG
GGTCTTCTCTGGTAGCTACTATGAGCGGCATTACAGAGGTAAATCCGCTGCCTCCTCATTACGTGTGTCCAAAATGCAAA
CACTCAGAGTTTGTGACGGACGGGTCTTTTGGCTGCGGAGTTGACATGCCTGACAAGTACTGCCCTAACTGCGGCACTTT
GATGAAAAAAGACGGCTTTGACATACCTTTTGAAGTGTTTATGGGCTTTGAAGGAGATAAGGAGCCGGATATAGACCTAA
ACTTTTCTGGAGAATATCAGCCCATAGCTCACAGGTACACTGAAGAACTTTTTGGAAAAGGCCATGTTTTCAGGGCAGGT
ACTATTGGAACGCTGGCGGATAAGACTGCTTACGGATATGTGAAAAAATACTTTGAAGAGAGGAATTTAACTGTACACAA
GTCAGAAATAAAAAGGCTGACAATGGGATGTACAGGCATAAAGAGAACCACAGGACAGCATCCCGGAGGAGTCATGGTGG
TTCCAAAGGACAAAAGCATTTACGACTTTACTCCAATTCAAAGGCCTGCAGATGCGGAAGATACCGATGTCATAACTACC
CATTTTGATTACCATTCTTTGAGTGGAAAGCTTCTAAAATTGGACATACTGGGGCATGATGACCCTACTGTAATAAGGAT
GCTGGAGGATTTGACAGGTGTAAATGCCAGAAAAATACCTCTGGACGACAAAAAGACCATGAGCCTTTTTACAAGCGTAG
AAGCTTTGGGAATAGACCCTGAGGAACTTGGCACTCCCGTTGGAACGCTAGGGCTTCCTGAGTTTGGAACAAAGTTTGTG
AGACAGATGCTAATTGAGACCCGTCCCACAACTTTTGATGAGCTTGTCAGGATAAGTGGGCTTTCTCATGGAACAGATGT
ATGGTTAAATAATGCGCAGGATATAATAAGAGAAGGGATCGCTACTTTAAAGGAAGTAATTGCTGCAAGAGACGACATAA
TGCTTTACTTAATAAGCAAAGGAATGGATAAAAAGCTTTCCTTTAAGATAATGGAAAATGTTAGAAAAGGAAAAGGCGTT
ACACAGGAAGAAATTGAAGAGATGAAAAAACACGGCGTGCCCGACTGGTTTATACAGTCCTGCCAGAAGATAAAATACAT
GTTCCCAAAAGCTCACGCTGTAGCCTATGTGATCATGGCATTTAGAATTGCGTATTTTAAGGTGTATTATCCTGAAGCTT
TCTATGCTACCTATTTTACTGTGAGAGCAGATGACTTTAACTTAGACATAGTTTTAGGGGGCAAAGAGAGCATAAAAAGG
GCAATAAAAGAAATTGAAGCGAAGGGCAACAACGCTACACCAAAAGAGAAAAACTTGTTGACAGTATTAGAGGTAGCACT
TGAGATGTACTTAAGGGGCATCAAATTCACAAATGTGGACCTATACAGGTCCGATGCCGAGAAGTTTTTAATTACAGAAG
AAGGACTTTTGCCTCCACTAAATTCTCTTGAAGGAGTGGGAATACAGGCCGCAAAGGCAATTGCCCAGGAGAGAGAAAAT
GGCAAATTTATATCCATTGAAGATTTCAGGAACCGAACCAGGGTAAGTAAAACTGTTATTGAAATATTAAAACAGTATGG
ATGTTTAGAAGATTTGCCAGAATCTAATCAATTAAGTTTATTTTGA

Upstream 100 bases:

>100_bases
AATGAAGGAGGAAAAATTGGGATTTGTAAAAGGATTTGCTGCCAGAATGAAGATGTACTTTGAAATATTGAGAATGTGGG
TTTAGAAAGAGGGATAGAAC

Downstream 100 bases:

>100_bases
TATTGCTTTACCAAAAGGTGTATGGTATAATTAGTATGGCAACCTAGAGGACTTTAAAAAGAGTGGGAGTTTCCCACTCT
TTAGTTTATATTTAAGGAGG

Product: DNA polymerase III PolC

Products: NA

Alternate protein names: PolIII

Number of amino acids: Translated: 1401; Mature: 1401

Protein sequence:

>1401_residues
MVPATFLENMQIKKVRVEKKSRKLTVVVSSFSSNAQKLSEFQSFLEESFPSLKEIKIVVESPSLSTVEEVLENWEKVVLE
LSEEYPSSLSFLKTCDVAKEGQNRITVKAPTYAIYEMAKSSKLDFAIREFLRNRYELNLDVELIFSEEGEEIAEKIIEED
IKAIEEVIQKDEKSKKEKSRSEENRVLLGKEMKAKPISIKDVSAETDEVVIEGEIFSIDFKELKSKVLMVFDITDYTSSI
LVKTFLTEEKYEILKDEIDVGTFVRLRGNVIYDKYEGDLVIDLKDLELIPPKKRMDLSEEKRVELHLHTQMSTLDAVPSA
TEVIKRAAEWGHKAVAITDHAVVQAFPEAMEASREYGVKVIYGMEGYMVDDGIPIVTGESEASLEGEFVVFDIETTGLSN
INDEIIEIGAVKIKNKKIVDTFETFVNPQIPISSFITKLTGIDESMVKDAPLIEEVLPKFLEFAKGAVLVAHNANFDVSF
IKSKAKKLGLTVENTVLDTLELSRHLYQDLKNYKLDTLAEFFEVKLLHHHRAVEDAKATAEIFIKMLEKLQEIGIKSVSE
INSVLMEREVDVKKLPVYHVTILVKDQKGLRNLYEIISRSNLEFFHRTPRIPKSLLVKMREGLIIGSACEQGEVFRALVS
NLEEKKLEDIINFYDYLEIQPVGNNEFLIERGEVRSVEELKEINRKIYELGKKYNKLVVATGDVHFLDPWDDVYRKILMA
GKGYKDADRQPPLYFRTTEEMLMEFEYLGEEAAREVVIENPNKIAEIVEDVKPIPEGTFPPVIEGAEEELRRITLEKAHE
IYGDPLPPIVQERLDRELNAIINNGYAVMYVIAQKLVSKSLQDGYLVGSRGSVGSSLVATMSGITEVNPLPPHYVCPKCK
HSEFVTDGSFGCGVDMPDKYCPNCGTLMKKDGFDIPFEVFMGFEGDKEPDIDLNFSGEYQPIAHRYTEELFGKGHVFRAG
TIGTLADKTAYGYVKKYFEERNLTVHKSEIKRLTMGCTGIKRTTGQHPGGVMVVPKDKSIYDFTPIQRPADAEDTDVITT
HFDYHSLSGKLLKLDILGHDDPTVIRMLEDLTGVNARKIPLDDKKTMSLFTSVEALGIDPEELGTPVGTLGLPEFGTKFV
RQMLIETRPTTFDELVRISGLSHGTDVWLNNAQDIIREGIATLKEVIAARDDIMLYLISKGMDKKLSFKIMENVRKGKGV
TQEEIEEMKKHGVPDWFIQSCQKIKYMFPKAHAVAYVIMAFRIAYFKVYYPEAFYATYFTVRADDFNLDIVLGGKESIKR
AIKEIEAKGNNATPKEKNLLTVLEVALEMYLRGIKFTNVDLYRSDAEKFLITEEGLLPPLNSLEGVGIQAAKAIAQEREN
GKFISIEDFRNRTRVSKTVIEILKQYGCLEDLPESNQLSLF

Sequences:

>Translated_1401_residues
MVPATFLENMQIKKVRVEKKSRKLTVVVSSFSSNAQKLSEFQSFLEESFPSLKEIKIVVESPSLSTVEEVLENWEKVVLE
LSEEYPSSLSFLKTCDVAKEGQNRITVKAPTYAIYEMAKSSKLDFAIREFLRNRYELNLDVELIFSEEGEEIAEKIIEED
IKAIEEVIQKDEKSKKEKSRSEENRVLLGKEMKAKPISIKDVSAETDEVVIEGEIFSIDFKELKSKVLMVFDITDYTSSI
LVKTFLTEEKYEILKDEIDVGTFVRLRGNVIYDKYEGDLVIDLKDLELIPPKKRMDLSEEKRVELHLHTQMSTLDAVPSA
TEVIKRAAEWGHKAVAITDHAVVQAFPEAMEASREYGVKVIYGMEGYMVDDGIPIVTGESEASLEGEFVVFDIETTGLSN
INDEIIEIGAVKIKNKKIVDTFETFVNPQIPISSFITKLTGIDESMVKDAPLIEEVLPKFLEFAKGAVLVAHNANFDVSF
IKSKAKKLGLTVENTVLDTLELSRHLYQDLKNYKLDTLAEFFEVKLLHHHRAVEDAKATAEIFIKMLEKLQEIGIKSVSE
INSVLMEREVDVKKLPVYHVTILVKDQKGLRNLYEIISRSNLEFFHRTPRIPKSLLVKMREGLIIGSACEQGEVFRALVS
NLEEKKLEDIINFYDYLEIQPVGNNEFLIERGEVRSVEELKEINRKIYELGKKYNKLVVATGDVHFLDPWDDVYRKILMA
GKGYKDADRQPPLYFRTTEEMLMEFEYLGEEAAREVVIENPNKIAEIVEDVKPIPEGTFPPVIEGAEEELRRITLEKAHE
IYGDPLPPIVQERLDRELNAIINNGYAVMYVIAQKLVSKSLQDGYLVGSRGSVGSSLVATMSGITEVNPLPPHYVCPKCK
HSEFVTDGSFGCGVDMPDKYCPNCGTLMKKDGFDIPFEVFMGFEGDKEPDIDLNFSGEYQPIAHRYTEELFGKGHVFRAG
TIGTLADKTAYGYVKKYFEERNLTVHKSEIKRLTMGCTGIKRTTGQHPGGVMVVPKDKSIYDFTPIQRPADAEDTDVITT
HFDYHSLSGKLLKLDILGHDDPTVIRMLEDLTGVNARKIPLDDKKTMSLFTSVEALGIDPEELGTPVGTLGLPEFGTKFV
RQMLIETRPTTFDELVRISGLSHGTDVWLNNAQDIIREGIATLKEVIAARDDIMLYLISKGMDKKLSFKIMENVRKGKGV
TQEEIEEMKKHGVPDWFIQSCQKIKYMFPKAHAVAYVIMAFRIAYFKVYYPEAFYATYFTVRADDFNLDIVLGGKESIKR
AIKEIEAKGNNATPKEKNLLTVLEVALEMYLRGIKFTNVDLYRSDAEKFLITEEGLLPPLNSLEGVGIQAAKAIAQEREN
GKFISIEDFRNRTRVSKTVIEILKQYGCLEDLPESNQLSLF
>Mature_1401_residues
MVPATFLENMQIKKVRVEKKSRKLTVVVSSFSSNAQKLSEFQSFLEESFPSLKEIKIVVESPSLSTVEEVLENWEKVVLE
LSEEYPSSLSFLKTCDVAKEGQNRITVKAPTYAIYEMAKSSKLDFAIREFLRNRYELNLDVELIFSEEGEEIAEKIIEED
IKAIEEVIQKDEKSKKEKSRSEENRVLLGKEMKAKPISIKDVSAETDEVVIEGEIFSIDFKELKSKVLMVFDITDYTSSI
LVKTFLTEEKYEILKDEIDVGTFVRLRGNVIYDKYEGDLVIDLKDLELIPPKKRMDLSEEKRVELHLHTQMSTLDAVPSA
TEVIKRAAEWGHKAVAITDHAVVQAFPEAMEASREYGVKVIYGMEGYMVDDGIPIVTGESEASLEGEFVVFDIETTGLSN
INDEIIEIGAVKIKNKKIVDTFETFVNPQIPISSFITKLTGIDESMVKDAPLIEEVLPKFLEFAKGAVLVAHNANFDVSF
IKSKAKKLGLTVENTVLDTLELSRHLYQDLKNYKLDTLAEFFEVKLLHHHRAVEDAKATAEIFIKMLEKLQEIGIKSVSE
INSVLMEREVDVKKLPVYHVTILVKDQKGLRNLYEIISRSNLEFFHRTPRIPKSLLVKMREGLIIGSACEQGEVFRALVS
NLEEKKLEDIINFYDYLEIQPVGNNEFLIERGEVRSVEELKEINRKIYELGKKYNKLVVATGDVHFLDPWDDVYRKILMA
GKGYKDADRQPPLYFRTTEEMLMEFEYLGEEAAREVVIENPNKIAEIVEDVKPIPEGTFPPVIEGAEEELRRITLEKAHE
IYGDPLPPIVQERLDRELNAIINNGYAVMYVIAQKLVSKSLQDGYLVGSRGSVGSSLVATMSGITEVNPLPPHYVCPKCK
HSEFVTDGSFGCGVDMPDKYCPNCGTLMKKDGFDIPFEVFMGFEGDKEPDIDLNFSGEYQPIAHRYTEELFGKGHVFRAG
TIGTLADKTAYGYVKKYFEERNLTVHKSEIKRLTMGCTGIKRTTGQHPGGVMVVPKDKSIYDFTPIQRPADAEDTDVITT
HFDYHSLSGKLLKLDILGHDDPTVIRMLEDLTGVNARKIPLDDKKTMSLFTSVEALGIDPEELGTPVGTLGLPEFGTKFV
RQMLIETRPTTFDELVRISGLSHGTDVWLNNAQDIIREGIATLKEVIAARDDIMLYLISKGMDKKLSFKIMENVRKGKGV
TQEEIEEMKKHGVPDWFIQSCQKIKYMFPKAHAVAYVIMAFRIAYFKVYYPEAFYATYFTVRADDFNLDIVLGGKESIKR
AIKEIEAKGNNATPKEKNLLTVLEVALEMYLRGIKFTNVDLYRSDAEKFLITEEGLLPPLNSLEGVGIQAAKAIAQEREN
GKFISIEDFRNRTRVSKTVIEILKQYGCLEDLPESNQLSLF

Specific function: Required for replicative DNA synthesis. This DNA polymerase also exhibits 3' to 5' exonuclease activity

COG id: COG2176

COG function: function code L; DNA polymerase III, alpha subunit (gram-positive type)

Gene ontology:

Cell location: Cytoplasm

Metaboloic importance: Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 exonuclease domain

Homologues:

Organism=Escherichia coli, GI1786381, Length=923, Percent_Identity=22.5352112676056, Blast_Score=113, Evalue=1e-25,
Organism=Escherichia coli, GI1786409, Length=171, Percent_Identity=30.4093567251462, Blast_Score=78, Evalue=4e-15,
Organism=Escherichia coli, GI1788149, Length=165, Percent_Identity=31.5151515151515, Blast_Score=70, Evalue=1e-12,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): DPO3_THETN (Q8RA32)

Other databases:

- EMBL:   AE008691
- RefSeq:   NP_623016.1
- ProteinModelPortal:   Q8RA32
- GeneID:   997866
- GenomeReviews:   AE008691_GR
- KEGG:   tte:TTE1398
- NMPDR:   fig|273068.3.peg.1363
- HOGENOM:   HBG617116
- OMA:   WKTTHFD
- ProtClustDB:   PRK00448
- BioCyc:   TTEN273068:TTE1398-MONOMER
- BRENDA:   2.7.7.7
- GO:   GO:0005737
- HAMAP:   MF_00356
- InterPro:   IPR011708
- InterPro:   IPR006054
- InterPro:   IPR006055
- InterPro:   IPR013520
- InterPro:   IPR023223
- InterPro:   IPR016027
- InterPro:   IPR004013
- InterPro:   IPR003141
- InterPro:   IPR006308
- InterPro:   IPR012337
- Gene3D:   G3DSA:1.20.5.140
- SMART:   SM00479
- SMART:   SM00481
- TIGRFAMs:   TIGR00573
- TIGRFAMs:   TIGR01405

Pfam domain/function: PF07733 DNA_pol3_alpha; PF00929 Exonuc_X-T; PF02811 PHP; SSF50249 Nucleic_acid_OB; SSF53098 RNaseH_fold

EC number: =2.7.7.7

Molecular weight: Translated: 158808; Mature: 158808

Theoretical pI: Translated: 4.91; Mature: 4.91

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.7 %Cys     (Translated Protein)
2.4 %Met     (Translated Protein)
3.1 %Cys+Met (Translated Protein)
0.7 %Cys     (Mature Protein)
2.4 %Met     (Mature Protein)
3.1 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MVPATFLENMQIKKVRVEKKSRKLTVVVSSFSSNAQKLSEFQSFLEESFPSLKEIKIVVE
CCCCHHHCCCCHHHHHHHHCCCEEEEEEECCCCCHHHHHHHHHHHHHHCCCCEEEEEEEE
SPSLSTVEEVLENWEKVVLELSEEYPSSLSFLKTCDVAKEGQNRITVKAPTYAIYEMAKS
CCCHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHCCCCEEEEECCHHHHHHHHHC
SKLDFAIREFLRNRYELNLDVELIFSEEGEEIAEKIIEEDIKAIEEVIQKDEKSKKEKSR
CCCHHHHHHHHHCCEEECEEEEEEECCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHC
SEENRVLLGKEMKAKPISIKDVSAETDEVVIEGEIFSIDFKELKSKVLMVFDITDYTSSI
CCCCCEEECCCCCCCCCEEEECCCCCCCEEEECEEEEEEHHHHCCCEEEEEEECHHHHHH
LVKTFLTEEKYEILKDEIDVGTFVRLRGNVIYDKYEGDLVIDLKDLELIPPKKRMDLSEE
HHHHHHHHHHHHHHHHHCCCCEEEEEECCEEEEECCCCEEEEEECCCCCCCHHHCCCCCC
KRVELHLHTQMSTLDAVPSATEVIKRAAEWGHKAVAITDHAVVQAFPEAMEASREYGVKV
CEEEEEEEHHHHHHHCCCCHHHHHHHHHHCCCCEEEEEHHHHHHHHHHHHHHHHHCCCEE
IYGMEGYMVDDGIPIVTGESEASLEGEFVVFDIETTGLSNINDEIIEIGAVKIKNKKIVD
EEECCCEEEECCEEEEECCCCCCCCCCEEEEEEEECCCCCCCHHHHEECEEEECCCHHHH
TFETFVNPQIPISSFITKLTGIDESMVKDAPLIEEVLPKFLEFAKGAVLVAHNANFDVSF
HHHHHCCCCCCHHHHHHHHHCCCHHHHCCCHHHHHHHHHHHHHHCCEEEEEECCCCCHHH
IKSKAKKLGLTVENTVLDTLELSRHLYQDLKNYKLDTLAEFFEVKLLHHHRAVEDAKATA
HHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHH
EIFIKMLEKLQEIGIKSVSEINSVLMEREVDVKKLPVYHVTILVKDQKGLRNLYEIISRS
HHHHHHHHHHHHCCCHHHHHHHHHHHHCCCCHHHCCEEEEEEEEECCHHHHHHHHHHHCC
NLEFFHRTPRIPKSLLVKMREGLIIGSACEQGEVFRALVSNLEEKKLEDIINFYDYLEIQ
CCHHHHCCCCCCHHHHHHHHCCEEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHCEEEE
PVGNNEFLIERGEVRSVEELKEINRKIYELGKKYNKLVVATGDVHFLDPWDDVYRKILMA
ECCCCCEEEECCCCCCHHHHHHHHHHHHHHHHHHCEEEEEECCEEEECCHHHHHHHHHHC
GKGYKDADRQPPLYFRTTEEMLMEFEYLGEEAAREVVIENPNKIAEIVEDVKPIPEGTFP
CCCCCCCCCCCCEEEECHHHHHHHHHHHCHHHHHHEECCCCHHHHHHHHHHCCCCCCCCC
PVIEGAEEELRRITLEKAHEIYGDPLPPIVQERLDRELNAIINNGYAVMYVIAQKLVSKS
CCCCCHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHH
LQDGYLVGSRGSVGSSLVATMSGITEVNPLPPHYVCPKCKHSEFVTDGSFGCGVDMPDKY
HCCCEEECCCCCCCHHHHHHHHCCCCCCCCCCCCCCCCCCCCCEECCCCCCCCCCCCHHH
CPNCGTLMKKDGFDIPFEVFMGFEGDKEPDIDLNFSGEYQPIAHRYTEELFGKGHVFRAG
CCCCCCHHCCCCCCCCHHHEECCCCCCCCCEEECCCCCCCHHHHHHHHHHCCCCCEEECC
TIGTLADKTAYGYVKKYFEERNLTVHKSEIKRLTMGCTGIKRTTGQHPGGVMVVPKDKSI
CCCHHHHHHHHHHHHHHHHHCCCEEEHHHHHHHHHCCCCCCCCCCCCCCCEEEEECCCCC
YDFTPIQRPADAEDTDVITTHFDYHSLSGKLLKLDILGHDDPTVIRMLEDLTGVNARKIP
CCCCCCCCCCCCCCCCEEEEECCCCCCCCCEEEEEEECCCCHHHHHHHHHHCCCCCEECC
LDDKKTMSLFTSVEALGIDPEELGTPVGTLGLPEFGTKFVRQMLIETRPTTFDELVRISG
CCCHHHHHHHHHHHHCCCCHHHHCCCCCCCCCCHHHHHHHHHHHHHCCCCCHHHHHHHHC
LSHGTDVWLNNAQDIIREGIATLKEVIAARDDIMLYLISKGMDKKLSFKIMENVRKGKGV
CCCCCHHHCCCHHHHHHHHHHHHHHHHHCCCCEEEEEECCCCCCHHHHHHHHHHHHCCCC
TQEEIEEMKKHGVPDWFIQSCQKIKYMFPKAHAVAYVIMAFRIAYFKVYYPEAFYATYFT
CHHHHHHHHHCCCCHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHEECCCEEEEEEEE
VRADDFNLDIVLGGKESIKRAIKEIEAKGNNATPKEKNLLTVLEVALEMYLRGIKFTNVD
EEECCCEEEEEECCHHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHCCCCEECEE
LYRSDAEKFLITEEGLLPPLNSLEGVGIQAAKAIAQERENGKFISIEDFRNRTRVSKTVI
EECCCCCCEEEECCCCCCCCCCCCCCCHHHHHHHHHHHCCCCEEEEHHHHHHHHHHHHHH
EILKQYGCLEDLPESNQLSLF
HHHHHCCCHHCCCCCCCCCCC
>Mature Secondary Structure
MVPATFLENMQIKKVRVEKKSRKLTVVVSSFSSNAQKLSEFQSFLEESFPSLKEIKIVVE
CCCCHHHCCCCHHHHHHHHCCCEEEEEEECCCCCHHHHHHHHHHHHHHCCCCEEEEEEEE
SPSLSTVEEVLENWEKVVLELSEEYPSSLSFLKTCDVAKEGQNRITVKAPTYAIYEMAKS
CCCHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHCCCCEEEEECCHHHHHHHHHC
SKLDFAIREFLRNRYELNLDVELIFSEEGEEIAEKIIEEDIKAIEEVIQKDEKSKKEKSR
CCCHHHHHHHHHCCEEECEEEEEEECCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHC
SEENRVLLGKEMKAKPISIKDVSAETDEVVIEGEIFSIDFKELKSKVLMVFDITDYTSSI
CCCCCEEECCCCCCCCCEEEECCCCCCCEEEECEEEEEEHHHHCCCEEEEEEECHHHHHH
LVKTFLTEEKYEILKDEIDVGTFVRLRGNVIYDKYEGDLVIDLKDLELIPPKKRMDLSEE
HHHHHHHHHHHHHHHHHCCCCEEEEEECCEEEEECCCCEEEEEECCCCCCCHHHCCCCCC
KRVELHLHTQMSTLDAVPSATEVIKRAAEWGHKAVAITDHAVVQAFPEAMEASREYGVKV
CEEEEEEEHHHHHHHCCCCHHHHHHHHHHCCCCEEEEEHHHHHHHHHHHHHHHHHCCCEE
IYGMEGYMVDDGIPIVTGESEASLEGEFVVFDIETTGLSNINDEIIEIGAVKIKNKKIVD
EEECCCEEEECCEEEEECCCCCCCCCCEEEEEEEECCCCCCCHHHHEECEEEECCCHHHH
TFETFVNPQIPISSFITKLTGIDESMVKDAPLIEEVLPKFLEFAKGAVLVAHNANFDVSF
HHHHHCCCCCCHHHHHHHHHCCCHHHHCCCHHHHHHHHHHHHHHCCEEEEEECCCCCHHH
IKSKAKKLGLTVENTVLDTLELSRHLYQDLKNYKLDTLAEFFEVKLLHHHRAVEDAKATA
HHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHH
EIFIKMLEKLQEIGIKSVSEINSVLMEREVDVKKLPVYHVTILVKDQKGLRNLYEIISRS
HHHHHHHHHHHHCCCHHHHHHHHHHHHCCCCHHHCCEEEEEEEEECCHHHHHHHHHHHCC
NLEFFHRTPRIPKSLLVKMREGLIIGSACEQGEVFRALVSNLEEKKLEDIINFYDYLEIQ
CCHHHHCCCCCCHHHHHHHHCCEEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHCEEEE
PVGNNEFLIERGEVRSVEELKEINRKIYELGKKYNKLVVATGDVHFLDPWDDVYRKILMA
ECCCCCEEEECCCCCCHHHHHHHHHHHHHHHHHHCEEEEEECCEEEECCHHHHHHHHHHC
GKGYKDADRQPPLYFRTTEEMLMEFEYLGEEAAREVVIENPNKIAEIVEDVKPIPEGTFP
CCCCCCCCCCCCEEEECHHHHHHHHHHHCHHHHHHEECCCCHHHHHHHHHHCCCCCCCCC
PVIEGAEEELRRITLEKAHEIYGDPLPPIVQERLDRELNAIINNGYAVMYVIAQKLVSKS
CCCCCHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHH
LQDGYLVGSRGSVGSSLVATMSGITEVNPLPPHYVCPKCKHSEFVTDGSFGCGVDMPDKY
HCCCEEECCCCCCCHHHHHHHHCCCCCCCCCCCCCCCCCCCCCEECCCCCCCCCCCCHHH
CPNCGTLMKKDGFDIPFEVFMGFEGDKEPDIDLNFSGEYQPIAHRYTEELFGKGHVFRAG
CCCCCCHHCCCCCCCCHHHEECCCCCCCCCEEECCCCCCCHHHHHHHHHHCCCCCEEECC
TIGTLADKTAYGYVKKYFEERNLTVHKSEIKRLTMGCTGIKRTTGQHPGGVMVVPKDKSI
CCCHHHHHHHHHHHHHHHHHCCCEEEHHHHHHHHHCCCCCCCCCCCCCCCEEEEECCCCC
YDFTPIQRPADAEDTDVITTHFDYHSLSGKLLKLDILGHDDPTVIRMLEDLTGVNARKIP
CCCCCCCCCCCCCCCCEEEEECCCCCCCCCEEEEEEECCCCHHHHHHHHHHCCCCCEECC
LDDKKTMSLFTSVEALGIDPEELGTPVGTLGLPEFGTKFVRQMLIETRPTTFDELVRISG
CCCHHHHHHHHHHHHCCCCHHHHCCCCCCCCCCHHHHHHHHHHHHHCCCCCHHHHHHHHC
LSHGTDVWLNNAQDIIREGIATLKEVIAARDDIMLYLISKGMDKKLSFKIMENVRKGKGV
CCCCCHHHCCCHHHHHHHHHHHHHHHHHCCCCEEEEEECCCCCCHHHHHHHHHHHHCCCC
TQEEIEEMKKHGVPDWFIQSCQKIKYMFPKAHAVAYVIMAFRIAYFKVYYPEAFYATYFT
CHHHHHHHHHCCCCHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHEECCCEEEEEEEE
VRADDFNLDIVLGGKESIKRAIKEIEAKGNNATPKEKNLLTVLEVALEMYLRGIKFTNVD
EEECCCEEEEEECCHHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHCCCCEECEE
LYRSDAEKFLITEEGLLPPLNSLEGVGIQAAKAIAQERENGKFISIEDFRNRTRVSKTVI
EECCCCCCEEEECCCCCCCCCCCCCCCHHHHHHHHHHHCCCCEEEEHHHHHHHHHHHHHH
EILKQYGCLEDLPESNQLSLF
HHHHHCCCHHCCCCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 11997336