Definition Geobacillus thermodenitrificans NG80-2 chromosome, complete genome.
Accession NC_009328
Length 3,550,319

Click here to switch to the map view.

The map label for this gene is polC [H]

Identifier: 138894778

GI number: 138894778

Start: 1172809

End: 1177137

Strand: Direct

Name: polC [H]

Synonym: GTNG_1112

Alternate gene names: 138894778

Gene position: 1172809-1177137 (Clockwise)

Preceding gene: 138894777

Following gene: 138894779

Centisome position: 33.03

GC content: 51.31

Gene sequence:

>4329_bases
ATGATTTCGTTGAGAGGGGAAGTCATGGTTACGAAAGAACAAAAAGAGCGGTTTCTCGTATTGCTCGAGCAGCTGAAGAT
GACGTCGGATGAATGGATGCCGTACTTTCGAGAGGCGGCCATTCGGAAAGTCGTGATTGATAAAGAGGAAAAAAGCTGGC
ATTTTCATTTTCAATTGGCGAACGTGCTGCCGGTTGATGTGTACAAGTCGTTTACGGACCGATTGGCAGCCGCATTCCGT
CATATCGCTGCTGTCCGTCATACGATTTATGTCGAAGCGCCGCATGTGACCGAAACGGATGTGCAGGCGTATTGGCCGCT
TTGCCTTGAACAGCTGCAAGAAGGCGTGTCGCCGCTCGTCGATTTGCTTAGCCGGCAGACGCCGGTGGTGAAAGGAAACA
AGCTCTTTGTCACCGCCCGTCATGAGGCAGAAGCGTTGGCCGTCAAGCGGCGATTCGCCAAAAAAATCGCGGATGTCTAC
GCTTCGTTTGGGTTCCCGCTCCTTCACCTCGAAGTCGGCATTCAACCGGCCGAGCAGGAAATGGAGCGGTTTTTGGCGCA
AAAACAGCAAGAAGATGAAGAACGAGCGCTCGCCGTGCTGACGGATTTGGCGAAAGAAGAAGAAAAAGCGGAAGCGGCTT
CTCCGTCCGGCCCGCTTGTCATCGGCTATCCGATCCGCGACGAGGAGCCGGTGCGTCCGCTTGAGACGATCGTCGAGGAA
GAGCGACGTGTCGTTGTGCAAGGGTATGTGTTTGACGCTGAAGTGACCGAACTCAAAAGTGGCCGTACGCTGCTGACGAT
GAAAATCACGGATTATACGAACTCTATTGTCATCAAAATGTTCTCGCGTGACAAAGAAGACGCTGCACTGATGTCCAGCG
TGAAAAAAGGCATGTGGGTGAAAGTGCGCGGCAGTGTGCAAAACGATACGTTCGTCCGCGATTTAGTCATTATCGCTAAT
GACTTAAACGAAGTAGCGGCGAACGAACGGCGCGATACGGCACCGGAAGGCGAAAAACGGGTCGAACTCCATTTACACAC
ACCGATGAGCCAAATGGATGCGGTCACTTCGGTGGCGAAGCTCATTGAACAGGCGAAAAAATGGGGGCACCCGGCGGTGG
CCATCACCGACCATGCCGTCGTTCAATCGTTTCCGGAAGCGTATAGTGCGGCGAAAAAACACGGCATGAAAGTGTTGTAT
GGGATGGAAGCGAACATCGTTGATGACGGGGTGCCGATCGCCTACAACGAGGCGCACCGTCGCCTTTCCGACGAGACGTA
TGTTGTCTTTGACGTCGAAACGACCGGATTGTCGGCTGTATACAACACGATCATCGAGTTGGCGGCGGTGAAAGTCAAAG
ACGGTGAAATCATCGATCGGTTTATGTCGTTTGCCAATCCGCACCATCCGTTATCGGTGACGACGATGGAATTGACGGGC
ATTACCGATGAGATGGTGAAAGACGCCCCGGATGTCGAAGAGGTGCTTCGCCGCTTTATCGATTGGGTCGGTGACTCAAC
GCTTGCCGCTCATAACGCTAGCTTTGACATCGGCTTTTTAAACGCAGGGCTCGCCAAAATGGGGCTTGGCAAAGTCATAA
ACCCGGTCATCGATACACTTGAACTCGCCCGTTTTTTATATCCGGATTTGAAAAACCATCGTCTCAATACGCTTTGTAAA
AAGTTTGACATTGAATTGACACAACACCACCGCGCCATTTATGACGCCGAGGCGACCGGGCATTTGCTGATGCGGCTGCT
GAAAGAAGCAGAGGAACGAGGCATTTTGTATCACGATGAGTTGAACAGCCGCACGCATAGCGAAGCATCATATCGGCTAT
CGCGCCCGTTTCATGTGACGTTATTGGCTCAAAACGAGACGGGGTTGAAAAATTTGTTTAAGCTCGTTTCGCTGTCACAC
GTTCAATATTTTCACCGTGTGCCGCGCATTCCGCGCTCGGTGCTTGTTAAGCATCGCGATGGCTTGCTTGTCGGTTCAGG
TTGCGACAAAGGGGAGCTGTTTGACAACTTGATCCAAAAGGCGCCGGAGGAAGTGGAAGAGATCGCCCGTTTTTACGATT
TCCTTGAGGTGCATCCGCCAGCGGTATACAAGCCGCTGATTGAGATGGACTATGTCAAAGATGAGGAAATGATCAAAGAT
ATTATTCGCAGCATCGTCGCCCTCGGCGAGAAGCTTGATATCCCGGTTGTCGCCACCGGCAACGTTCATTACTTGAATCC
GGAAGATAAAATTTACCGGAAAATTTTAATTCACTCGCAAGGTGGAGCGAACCCGCTCAACCGGCACGAGCTGCCGGACG
TGTATTTCCGCACAACGGATGAAATGCTTGACTGTTTTTCGTTTTTAGGGGCGGAAAAAGCGAAAGAAATCGTCGTCGAC
AATACACAAAAAATCGCCTCGTTAATCGGCGAGGTGAAGCCGATTAAAGACGATTTGTATACGCCGCGCATCGAGGGAGC
GGACGACGAAATCCGGGAAATGAGCTATCGGCGCGCGAAAGACATTTATGGCGATCCGCTGCCGAAGATCGTCGAAGAGC
GGCTCGAAAAAGAGTTGAAAAGCATCATCGGCCACGGTTTTGCTGTTATTTATTTAATTTCTCATAAACTGGTGAAAAAA
TCGCTTGATGACGGCTATCTCGTCGGTTCGCGTGGGTCGGTCGGATCGTCGTTTGTCGCGACGATGACGGAAATTACCGA
AGTGAACCCGCTGCCGCCGCATTACGTCTGCCCGAACTGCAAACACTCCGAATTTTTTAATGACGGCTCAGTCGGCTCGG
GCTTTGACTTGCCGGATAAAAACTGCCCGCAATGTGGGACGAAGTACAAAAAAGACGGGCACGACATCCCGTTTGAGACG
TTCCTCGGCTTTAAGGGCGACAAAGTACCAGATATTGACTTGAACTTCTCGGGTGAGTACCAGCCGCGAGCCCACAACTA
TACGAAAGTGTTGTTTGGTGAAGACAATGTCTATCGAGCCGGGACGATTGGCACAGTTGCTGACAAAACGGCATACGGAT
TTGTCAAAGGCTATGCGAGCGACCATAACTTAGAGCTGCGCGGCGCAGAAATCGACCGGCTTGCGGCCGGCTGCACCGGG
GTGAAACGGACGACCGGGCAGCATCCGGGCGGCATTATTGTCGTTCCAGATTACATGGAAATTTATGACTTTACGCCGAT
TCAATATCCAGCCGATGACACGTCATCAGAGTGGCGAACAACCCACTTTGACTTTCATTCGATTCACGATAACTTGTTGA
AGTTAGACATTCTTGGGCACGATGATCCGACGGTCATTCGCATGTTGCAAGATTTAAGCGGTATTGATCCGAAGACCATT
CCGACCGACGACCCGGATGTGATGGGTATTTTCAGCAGCACTGAGCCGCTTGGCGTCACGCCGGAGCAAATTATGTGTAA
CGTCGGCACGATTGGTATTCCGGAGTTTGGCACGCGCTTTGTTCGACAAATGTTGGAAGAAACGAAACCAAAAACGTTTT
CCGAGCTCGTGCAAATTTCCGGTTTGTCGCACGGCACCGATGTCTGGCTCGGCAATGCACAAGAGCTCATCCAAAACGGG
ACGTGCACGTTGTCGGAAGTGATCGGCTGCCGCGACGACATTATGGTATATCTCATTTATCGCGGGCTTGAACCGTCGCT
GGCGTTTAAAATTATGGAATCGGTGCGCAAGGGGAAAGGGTTGACGCCGGAATTTGAAGAAGAAATGCGCAAGCATGACG
TACCGGAGTGGTACATCGATTCGTGCAAAAAAATCAAATACATGTTCCCGAAAGCGCACGCCGCCGCCTACGTTCTCATG
GCGGTGCGCATCGCCTATTTCAAAGTGCACCATCCGCTCTTGTATTACGCGTCATACTTTACGGTGCGGGCGGAAGATTT
CGATCTTGATGCCATGATCAAAGGCTCAGCCGCCATCCGTAAGCGGATTGAGGAAATTAATGCCAAAGGCATCCAGGCCA
CCGCGAAGGAGAAGAGCTTGCTCACTGTGCTTGAAGTAGCGCTAGAAATGTGCGAGCGCGGCTTTACCTTTAAAAATATT
GACTTGTATCGTTCGCAGGCGACCGAATTTGTCATTGATGGCCATTCACTCATTCCGCCGTTTAATGCCATCCCGGGGCT
CGGGACGAACGTGGCACAAAACATTGTGCGCGCCCGCGAAGAAGGGGAGTTTTTGTCGAAAGAAGATTTGCAGCAGCGTG
GGAAAGTATCGAAAACACTTCTTGAGTATCTCGAAAGTCGTGGTTGCCTCGACTCACTTCCGGATCATAACCAACTGTCT
CTGTTCTGA

Upstream 100 bases:

>100_bases
CGTCTTTTGCAAGGATAAACGAACGGCGCCGGCGAAAAAGAACCCGCTTCTTTTTTCGCCGGCGCTGTTGCCGTTTGTAT
GGTATGATAGAGAAAGAGAA

Downstream 100 bases:

>100_bases
CGGAAGGTTTTTCGTTGCAATATATTTCCGAATGTGTTATAGTTTTAGTGGAATTGGCAAAGATAATGACAAGCAAAGAG
TGGGGAAACCCACTCTTTCG

Product: DNA polymerase III PolC

Products: NA

Alternate protein names: PolIII [H]

Number of amino acids: Translated: 1442; Mature: 1442

Protein sequence:

>1442_residues
MISLRGEVMVTKEQKERFLVLLEQLKMTSDEWMPYFREAAIRKVVIDKEEKSWHFHFQLANVLPVDVYKSFTDRLAAAFR
HIAAVRHTIYVEAPHVTETDVQAYWPLCLEQLQEGVSPLVDLLSRQTPVVKGNKLFVTARHEAEALAVKRRFAKKIADVY
ASFGFPLLHLEVGIQPAEQEMERFLAQKQQEDEERALAVLTDLAKEEEKAEAASPSGPLVIGYPIRDEEPVRPLETIVEE
ERRVVVQGYVFDAEVTELKSGRTLLTMKITDYTNSIVIKMFSRDKEDAALMSSVKKGMWVKVRGSVQNDTFVRDLVIIAN
DLNEVAANERRDTAPEGEKRVELHLHTPMSQMDAVTSVAKLIEQAKKWGHPAVAITDHAVVQSFPEAYSAAKKHGMKVLY
GMEANIVDDGVPIAYNEAHRRLSDETYVVFDVETTGLSAVYNTIIELAAVKVKDGEIIDRFMSFANPHHPLSVTTMELTG
ITDEMVKDAPDVEEVLRRFIDWVGDSTLAAHNASFDIGFLNAGLAKMGLGKVINPVIDTLELARFLYPDLKNHRLNTLCK
KFDIELTQHHRAIYDAEATGHLLMRLLKEAEERGILYHDELNSRTHSEASYRLSRPFHVTLLAQNETGLKNLFKLVSLSH
VQYFHRVPRIPRSVLVKHRDGLLVGSGCDKGELFDNLIQKAPEEVEEIARFYDFLEVHPPAVYKPLIEMDYVKDEEMIKD
IIRSIVALGEKLDIPVVATGNVHYLNPEDKIYRKILIHSQGGANPLNRHELPDVYFRTTDEMLDCFSFLGAEKAKEIVVD
NTQKIASLIGEVKPIKDDLYTPRIEGADDEIREMSYRRAKDIYGDPLPKIVEERLEKELKSIIGHGFAVIYLISHKLVKK
SLDDGYLVGSRGSVGSSFVATMTEITEVNPLPPHYVCPNCKHSEFFNDGSVGSGFDLPDKNCPQCGTKYKKDGHDIPFET
FLGFKGDKVPDIDLNFSGEYQPRAHNYTKVLFGEDNVYRAGTIGTVADKTAYGFVKGYASDHNLELRGAEIDRLAAGCTG
VKRTTGQHPGGIIVVPDYMEIYDFTPIQYPADDTSSEWRTTHFDFHSIHDNLLKLDILGHDDPTVIRMLQDLSGIDPKTI
PTDDPDVMGIFSSTEPLGVTPEQIMCNVGTIGIPEFGTRFVRQMLEETKPKTFSELVQISGLSHGTDVWLGNAQELIQNG
TCTLSEVIGCRDDIMVYLIYRGLEPSLAFKIMESVRKGKGLTPEFEEEMRKHDVPEWYIDSCKKIKYMFPKAHAAAYVLM
AVRIAYFKVHHPLLYYASYFTVRAEDFDLDAMIKGSAAIRKRIEEINAKGIQATAKEKSLLTVLEVALEMCERGFTFKNI
DLYRSQATEFVIDGHSLIPPFNAIPGLGTNVAQNIVRAREEGEFLSKEDLQQRGKVSKTLLEYLESRGCLDSLPDHNQLS
LF

Sequences:

>Translated_1442_residues
MISLRGEVMVTKEQKERFLVLLEQLKMTSDEWMPYFREAAIRKVVIDKEEKSWHFHFQLANVLPVDVYKSFTDRLAAAFR
HIAAVRHTIYVEAPHVTETDVQAYWPLCLEQLQEGVSPLVDLLSRQTPVVKGNKLFVTARHEAEALAVKRRFAKKIADVY
ASFGFPLLHLEVGIQPAEQEMERFLAQKQQEDEERALAVLTDLAKEEEKAEAASPSGPLVIGYPIRDEEPVRPLETIVEE
ERRVVVQGYVFDAEVTELKSGRTLLTMKITDYTNSIVIKMFSRDKEDAALMSSVKKGMWVKVRGSVQNDTFVRDLVIIAN
DLNEVAANERRDTAPEGEKRVELHLHTPMSQMDAVTSVAKLIEQAKKWGHPAVAITDHAVVQSFPEAYSAAKKHGMKVLY
GMEANIVDDGVPIAYNEAHRRLSDETYVVFDVETTGLSAVYNTIIELAAVKVKDGEIIDRFMSFANPHHPLSVTTMELTG
ITDEMVKDAPDVEEVLRRFIDWVGDSTLAAHNASFDIGFLNAGLAKMGLGKVINPVIDTLELARFLYPDLKNHRLNTLCK
KFDIELTQHHRAIYDAEATGHLLMRLLKEAEERGILYHDELNSRTHSEASYRLSRPFHVTLLAQNETGLKNLFKLVSLSH
VQYFHRVPRIPRSVLVKHRDGLLVGSGCDKGELFDNLIQKAPEEVEEIARFYDFLEVHPPAVYKPLIEMDYVKDEEMIKD
IIRSIVALGEKLDIPVVATGNVHYLNPEDKIYRKILIHSQGGANPLNRHELPDVYFRTTDEMLDCFSFLGAEKAKEIVVD
NTQKIASLIGEVKPIKDDLYTPRIEGADDEIREMSYRRAKDIYGDPLPKIVEERLEKELKSIIGHGFAVIYLISHKLVKK
SLDDGYLVGSRGSVGSSFVATMTEITEVNPLPPHYVCPNCKHSEFFNDGSVGSGFDLPDKNCPQCGTKYKKDGHDIPFET
FLGFKGDKVPDIDLNFSGEYQPRAHNYTKVLFGEDNVYRAGTIGTVADKTAYGFVKGYASDHNLELRGAEIDRLAAGCTG
VKRTTGQHPGGIIVVPDYMEIYDFTPIQYPADDTSSEWRTTHFDFHSIHDNLLKLDILGHDDPTVIRMLQDLSGIDPKTI
PTDDPDVMGIFSSTEPLGVTPEQIMCNVGTIGIPEFGTRFVRQMLEETKPKTFSELVQISGLSHGTDVWLGNAQELIQNG
TCTLSEVIGCRDDIMVYLIYRGLEPSLAFKIMESVRKGKGLTPEFEEEMRKHDVPEWYIDSCKKIKYMFPKAHAAAYVLM
AVRIAYFKVHHPLLYYASYFTVRAEDFDLDAMIKGSAAIRKRIEEINAKGIQATAKEKSLLTVLEVALEMCERGFTFKNI
DLYRSQATEFVIDGHSLIPPFNAIPGLGTNVAQNIVRAREEGEFLSKEDLQQRGKVSKTLLEYLESRGCLDSLPDHNQLS
LF
>Mature_1442_residues
MISLRGEVMVTKEQKERFLVLLEQLKMTSDEWMPYFREAAIRKVVIDKEEKSWHFHFQLANVLPVDVYKSFTDRLAAAFR
HIAAVRHTIYVEAPHVTETDVQAYWPLCLEQLQEGVSPLVDLLSRQTPVVKGNKLFVTARHEAEALAVKRRFAKKIADVY
ASFGFPLLHLEVGIQPAEQEMERFLAQKQQEDEERALAVLTDLAKEEEKAEAASPSGPLVIGYPIRDEEPVRPLETIVEE
ERRVVVQGYVFDAEVTELKSGRTLLTMKITDYTNSIVIKMFSRDKEDAALMSSVKKGMWVKVRGSVQNDTFVRDLVIIAN
DLNEVAANERRDTAPEGEKRVELHLHTPMSQMDAVTSVAKLIEQAKKWGHPAVAITDHAVVQSFPEAYSAAKKHGMKVLY
GMEANIVDDGVPIAYNEAHRRLSDETYVVFDVETTGLSAVYNTIIELAAVKVKDGEIIDRFMSFANPHHPLSVTTMELTG
ITDEMVKDAPDVEEVLRRFIDWVGDSTLAAHNASFDIGFLNAGLAKMGLGKVINPVIDTLELARFLYPDLKNHRLNTLCK
KFDIELTQHHRAIYDAEATGHLLMRLLKEAEERGILYHDELNSRTHSEASYRLSRPFHVTLLAQNETGLKNLFKLVSLSH
VQYFHRVPRIPRSVLVKHRDGLLVGSGCDKGELFDNLIQKAPEEVEEIARFYDFLEVHPPAVYKPLIEMDYVKDEEMIKD
IIRSIVALGEKLDIPVVATGNVHYLNPEDKIYRKILIHSQGGANPLNRHELPDVYFRTTDEMLDCFSFLGAEKAKEIVVD
NTQKIASLIGEVKPIKDDLYTPRIEGADDEIREMSYRRAKDIYGDPLPKIVEERLEKELKSIIGHGFAVIYLISHKLVKK
SLDDGYLVGSRGSVGSSFVATMTEITEVNPLPPHYVCPNCKHSEFFNDGSVGSGFDLPDKNCPQCGTKYKKDGHDIPFET
FLGFKGDKVPDIDLNFSGEYQPRAHNYTKVLFGEDNVYRAGTIGTVADKTAYGFVKGYASDHNLELRGAEIDRLAAGCTG
VKRTTGQHPGGIIVVPDYMEIYDFTPIQYPADDTSSEWRTTHFDFHSIHDNLLKLDILGHDDPTVIRMLQDLSGIDPKTI
PTDDPDVMGIFSSTEPLGVTPEQIMCNVGTIGIPEFGTRFVRQMLEETKPKTFSELVQISGLSHGTDVWLGNAQELIQNG
TCTLSEVIGCRDDIMVYLIYRGLEPSLAFKIMESVRKGKGLTPEFEEEMRKHDVPEWYIDSCKKIKYMFPKAHAAAYVLM
AVRIAYFKVHHPLLYYASYFTVRAEDFDLDAMIKGSAAIRKRIEEINAKGIQATAKEKSLLTVLEVALEMCERGFTFKNI
DLYRSQATEFVIDGHSLIPPFNAIPGLGTNVAQNIVRAREEGEFLSKEDLQQRGKVSKTLLEYLESRGCLDSLPDHNQLS
LF

Specific function: Required for replicative DNA synthesis. This DNA polymerase also exhibits 3' to 5' exonuclease activity [H]

COG id: COG2176

COG function: function code L; DNA polymerase III, alpha subunit (gram-positive type)

Gene ontology:

Cell location: Cytoplasm [H]

Metaboloic importance: Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 exonuclease domain [H]

Homologues:

Organism=Escherichia coli, GI1786381, Length=925, Percent_Identity=22.8108108108108, Blast_Score=131, Evalue=3e-31,
Organism=Escherichia coli, GI1788149, Length=166, Percent_Identity=31.3253012048193, Blast_Score=78, Evalue=4e-15,
Organism=Escherichia coli, GI1786409, Length=162, Percent_Identity=31.4814814814815, Blast_Score=75, Evalue=3e-14,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR011708
- InterPro:   IPR006054
- InterPro:   IPR006055
- InterPro:   IPR013520
- InterPro:   IPR016027
- InterPro:   IPR004365
- InterPro:   IPR004013
- InterPro:   IPR003141
- InterPro:   IPR006308
- InterPro:   IPR012337 [H]

Pfam domain/function: PF07733 DNA_pol3_alpha; PF00929 Exonuc_X-T; PF02811 PHP; PF01336 tRNA_anti [H]

EC number: =2.7.7.7 [H]

Molecular weight: Translated: 162652; Mature: 162652

Theoretical pI: Translated: 5.56; Mature: 5.56

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.0 %Cys     (Translated Protein)
2.4 %Met     (Translated Protein)
3.5 %Cys+Met (Translated Protein)
1.0 %Cys     (Mature Protein)
2.4 %Met     (Mature Protein)
3.5 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MISLRGEVMVTKEQKERFLVLLEQLKMTSDEWMPYFREAAIRKVVIDKEEKSWHFHFQLA
CCCCCCCEEEEHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHCCCCCCCEEEEEEEC
NVLPVDVYKSFTDRLAAAFRHIAAVRHTIYVEAPHVTETDVQAYWPLCLEQLQEGVSPLV
CCCHHHHHHHHHHHHHHHHHHHHHHHHEEEEECCCCCCCHHHHHHHHHHHHHHHHHHHHH
DLLSRQTPVVKGNKLFVTARHEAEALAVKRRFAKKIADVYASFGFPLLHLEVGIQPAEQE
HHHCCCCCEEECCEEEEEECCHHHHHHHHHHHHHHHHHHHHHCCCEEEEEEECCCCHHHH
MERFLAQKQQEDEERALAVLTDLAKEEEKAEAASPSGPLVIGYPIRDEEPVRPLETIVEE
HHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHCCCCCCCEEEEECCCCCCCCCHHHHHHHH
ERRVVVQGYVFDAEVTELKSGRTLLTMKITDYTNSIVIKMFSRDKEDAALMSSVKKGMWV
HCEEEEEEEEECCHHHHHCCCCEEEEEEECCCCCEEEEEEECCCCHHHHHHHHHHCCCEE
KVRGSVQNDTFVRDLVIIANDLNEVAANERRDTAPEGEKRVELHLHTPMSQMDAVTSVAK
EEECCCCCCHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCEEEEEEECCHHHHHHHHHHHH
LIEQAKKWGHPAVAITDHAVVQSFPEAYSAAKKHGMKVLYGMEANIVDDGVPIAYNEAHR
HHHHHHHCCCCEEEEECHHHHHHHHHHHHHHHHCCCEEEEECCCCCCCCCCCEEEHHHHH
RLSDETYVVFDVETTGLSAVYNTIIELAAVKVKDGEIIDRFMSFANPHHPLSVTTMELTG
HCCCCEEEEEEECCCCHHHHHHHHHHHHHEEECCHHHHHHHHHHCCCCCCCEEEEEEECC
ITDEMVKDAPDVEEVLRRFIDWVGDSTLAAHNASFDIGFLNAGLAKMGLGKVINPVIDTL
CCHHHHHCCCCHHHHHHHHHHHHCCCCEEECCCCCEEHHHHCCHHHHHHHHHHHHHHHHH
ELARFLYPDLKNHRLNTLCKKFDIELTQHHRAIYDAEATGHLLMRLLKEAEERGILYHDE
HHHHHHCCCCCCCHHHHHHHHHCCHHHHHHHHHHCCCHHHHHHHHHHHHHHHCCCEEECC
LNSRTHSEASYRLSRPFHVTLLAQNETGLKNLFKLVSLSHVQYFHRVPRIPRSVLVKHRD
CCCCCCCCHHHEECCCEEEEEEECCCCCHHHHHHHHHHHHHHHHHHCCCCCHHHHHHCCC
GLLVGSGCDKGELFDNLIQKAPEEVEEIARFYDFLEVHPPAVYKPLIEMDYVKDEEMIKD
CEEECCCCCCHHHHHHHHHHCHHHHHHHHHHHHHHHCCCCHHHHHHHHHHCCCCHHHHHH
IIRSIVALGEKLDIPVVATGNVHYLNPEDKIYRKILIHSQGGANPLNRHELPDVYFRTTD
HHHHHHHCCCCCCCCEEECCCEEEECCHHHHHHHHHEECCCCCCCCCCCCCCCHHHCCHH
EMLDCFSFLGAEKAKEIVVDNTQKIASLIGEVKPIKDDLYTPRIEGADDEIREMSYRRAK
HHHHHHHHHCHHHHHHHHHCCHHHHHHHHHCCCCCHHHCCCCCCCCCCHHHHHHHHHHHH
DIYGDPLPKIVEERLEKELKSIIGHGFAVIYLISHKLVKKSLDDGYLVGSRGSVGSSFVA
HCCCCCCHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHCCCCCEEECCCCCCCHHHHH
TMTEITEVNPLPPHYVCPNCKHSEFFNDGSVGSGFDLPDKNCPQCGTKYKKDGHDIPFET
HHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHH
FLGFKGDKVPDIDLNFSGEYQPRAHNYTKVLFGEDNVYRAGTIGTVADKTAYGFVKGYAS
HCCCCCCCCCCCCCCCCCCCCCCCCCCEEEEECCCCEEECCCCCCHHHHHHHHHHCCCCC
DHNLELRGAEIDRLAAGCTGVKRTTGQHPGGIIVVPDYMEIYDFTPIQYPADDTSSEWRT
CCCEEEECCHHHHHHHCCCCCCCCCCCCCCCEEECCCHHHHHCCCCCCCCCCCCCCCCEE
THFDFHSIHDNLLKLDILGHDDPTVIRMLQDLSGIDPKTIPTDDPDVMGIFSSTEPLGVT
EECCHHHHCCCEEEEEEECCCCHHHHHHHHHHCCCCCCCCCCCCCCEEEEECCCCCCCCC
PEQIMCNVGTIGIPEFGTRFVRQMLEETKPKTFSELVQISGLSHGTDVWLGNAQELIQNG
HHHHHCCCCCCCCCHHHHHHHHHHHHHCCCHHHHHHHHHCCCCCCCCEEECCHHHHHCCC
TCTLSEVIGCRDDIMVYLIYRGLEPSLAFKIMESVRKGKGLTPEFEEEMRKHDVPEWYID
CCCHHHHHCCCHHHEEEEHHHCCCHHHHHHHHHHHHHCCCCCCHHHHHHHHCCCCHHHHH
SCKKIKYMFPKAHAAAYVLMAVRIAYFKVHHPLLYYASYFTVRAEDFDLDAMIKGSAAIR
HHHHHHHHCCHHHHHHHHHHHHHHHHHHHHCHHHHHHHEEEEEECCCCCHHHCCCHHHHH
KRIEEINAKGIQATAKEKSLLTVLEVALEMCERGFTFKNIDLYRSQATEFVIDGHSLIPP
HHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHCCCEEEECCCCCCCC
FNAIPGLGTNVAQNIVRAREEGEFLSKEDLQQRGKVSKTLLEYLESRGCLDSLPDHNQLS
CCCCCCCCHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHCCCHHCCCCCCCCC
LF
CC
>Mature Secondary Structure
MISLRGEVMVTKEQKERFLVLLEQLKMTSDEWMPYFREAAIRKVVIDKEEKSWHFHFQLA
CCCCCCCEEEEHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHCCCCCCCEEEEEEEC
NVLPVDVYKSFTDRLAAAFRHIAAVRHTIYVEAPHVTETDVQAYWPLCLEQLQEGVSPLV
CCCHHHHHHHHHHHHHHHHHHHHHHHHEEEEECCCCCCCHHHHHHHHHHHHHHHHHHHHH
DLLSRQTPVVKGNKLFVTARHEAEALAVKRRFAKKIADVYASFGFPLLHLEVGIQPAEQE
HHHCCCCCEEECCEEEEEECCHHHHHHHHHHHHHHHHHHHHHCCCEEEEEEECCCCHHHH
MERFLAQKQQEDEERALAVLTDLAKEEEKAEAASPSGPLVIGYPIRDEEPVRPLETIVEE
HHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHCCCCCCCEEEEECCCCCCCCCHHHHHHHH
ERRVVVQGYVFDAEVTELKSGRTLLTMKITDYTNSIVIKMFSRDKEDAALMSSVKKGMWV
HCEEEEEEEEECCHHHHHCCCCEEEEEEECCCCCEEEEEEECCCCHHHHHHHHHHCCCEE
KVRGSVQNDTFVRDLVIIANDLNEVAANERRDTAPEGEKRVELHLHTPMSQMDAVTSVAK
EEECCCCCCHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCEEEEEEECCHHHHHHHHHHHH
LIEQAKKWGHPAVAITDHAVVQSFPEAYSAAKKHGMKVLYGMEANIVDDGVPIAYNEAHR
HHHHHHHCCCCEEEEECHHHHHHHHHHHHHHHHCCCEEEEECCCCCCCCCCCEEEHHHHH
RLSDETYVVFDVETTGLSAVYNTIIELAAVKVKDGEIIDRFMSFANPHHPLSVTTMELTG
HCCCCEEEEEEECCCCHHHHHHHHHHHHHEEECCHHHHHHHHHHCCCCCCCEEEEEEECC
ITDEMVKDAPDVEEVLRRFIDWVGDSTLAAHNASFDIGFLNAGLAKMGLGKVINPVIDTL
CCHHHHHCCCCHHHHHHHHHHHHCCCCEEECCCCCEEHHHHCCHHHHHHHHHHHHHHHHH
ELARFLYPDLKNHRLNTLCKKFDIELTQHHRAIYDAEATGHLLMRLLKEAEERGILYHDE
HHHHHHCCCCCCCHHHHHHHHHCCHHHHHHHHHHCCCHHHHHHHHHHHHHHHCCCEEECC
LNSRTHSEASYRLSRPFHVTLLAQNETGLKNLFKLVSLSHVQYFHRVPRIPRSVLVKHRD
CCCCCCCCHHHEECCCEEEEEEECCCCCHHHHHHHHHHHHHHHHHHCCCCCHHHHHHCCC
GLLVGSGCDKGELFDNLIQKAPEEVEEIARFYDFLEVHPPAVYKPLIEMDYVKDEEMIKD
CEEECCCCCCHHHHHHHHHHCHHHHHHHHHHHHHHHCCCCHHHHHHHHHHCCCCHHHHHH
IIRSIVALGEKLDIPVVATGNVHYLNPEDKIYRKILIHSQGGANPLNRHELPDVYFRTTD
HHHHHHHCCCCCCCCEEECCCEEEECCHHHHHHHHHEECCCCCCCCCCCCCCCHHHCCHH
EMLDCFSFLGAEKAKEIVVDNTQKIASLIGEVKPIKDDLYTPRIEGADDEIREMSYRRAK
HHHHHHHHHCHHHHHHHHHCCHHHHHHHHHCCCCCHHHCCCCCCCCCCHHHHHHHHHHHH
DIYGDPLPKIVEERLEKELKSIIGHGFAVIYLISHKLVKKSLDDGYLVGSRGSVGSSFVA
HCCCCCCHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHCCCCCEEECCCCCCCHHHHH
TMTEITEVNPLPPHYVCPNCKHSEFFNDGSVGSGFDLPDKNCPQCGTKYKKDGHDIPFET
HHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHH
FLGFKGDKVPDIDLNFSGEYQPRAHNYTKVLFGEDNVYRAGTIGTVADKTAYGFVKGYAS
HCCCCCCCCCCCCCCCCCCCCCCCCCCEEEEECCCCEEECCCCCCHHHHHHHHHHCCCCC
DHNLELRGAEIDRLAAGCTGVKRTTGQHPGGIIVVPDYMEIYDFTPIQYPADDTSSEWRT
CCCEEEECCHHHHHHHCCCCCCCCCCCCCCCEEECCCHHHHHCCCCCCCCCCCCCCCCEE
THFDFHSIHDNLLKLDILGHDDPTVIRMLQDLSGIDPKTIPTDDPDVMGIFSSTEPLGVT
EECCHHHHCCCEEEEEEECCCCHHHHHHHHHHCCCCCCCCCCCCCCEEEEECCCCCCCCC
PEQIMCNVGTIGIPEFGTRFVRQMLEETKPKTFSELVQISGLSHGTDVWLGNAQELIQNG
HHHHHCCCCCCCCCHHHHHHHHHHHHHCCCHHHHHHHHHCCCCCCCCEEECCHHHHHCCC
TCTLSEVIGCRDDIMVYLIYRGLEPSLAFKIMESVRKGKGLTPEFEEEMRKHDVPEWYID
CCCHHHHHCCCHHHEEEEHHHCCCHHHHHHHHHHHHHCCCCCCHHHHHHHHCCCCHHHHH
SCKKIKYMFPKAHAAAYVLMAVRIAYFKVHHPLLYYASYFTVRAEDFDLDAMIKGSAAIR
HHHHHHHHCCHHHHHHHHHHHHHHHHHHHHCHHHHHHHEEEEEECCCCCHHHCCCHHHHH
KRIEEINAKGIQATAKEKSLLTVLEVALEMCERGFTFKNIDLYRSQATEFVIDGHSLIPP
HHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHCCCEEEECCCCCCCC
FNAIPGLGTNVAQNIVRAREEGEFLSKEDLQQRGKVSKTLLEYLESRGCLDSLPDHNQLS
CCCCCCCCHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHCCCHHCCCCCCCCC
LF
CC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 1901559; 2499883; 1840638; 9384377; 7679775; 2515995; 8491709; 1312503 [H]