| Definition | Geobacillus thermodenitrificans NG80-2 chromosome, complete genome. |
|---|---|
| Accession | NC_009328 |
| Length | 3,550,319 |
Click here to switch to the map view.
The map label for this gene is polC [H]
Identifier: 138894778
GI number: 138894778
Start: 1172809
End: 1177137
Strand: Direct
Name: polC [H]
Synonym: GTNG_1112
Alternate gene names: 138894778
Gene position: 1172809-1177137 (Clockwise)
Preceding gene: 138894777
Following gene: 138894779
Centisome position: 33.03
GC content: 51.31
Gene sequence:
>4329_bases ATGATTTCGTTGAGAGGGGAAGTCATGGTTACGAAAGAACAAAAAGAGCGGTTTCTCGTATTGCTCGAGCAGCTGAAGAT GACGTCGGATGAATGGATGCCGTACTTTCGAGAGGCGGCCATTCGGAAAGTCGTGATTGATAAAGAGGAAAAAAGCTGGC ATTTTCATTTTCAATTGGCGAACGTGCTGCCGGTTGATGTGTACAAGTCGTTTACGGACCGATTGGCAGCCGCATTCCGT CATATCGCTGCTGTCCGTCATACGATTTATGTCGAAGCGCCGCATGTGACCGAAACGGATGTGCAGGCGTATTGGCCGCT TTGCCTTGAACAGCTGCAAGAAGGCGTGTCGCCGCTCGTCGATTTGCTTAGCCGGCAGACGCCGGTGGTGAAAGGAAACA AGCTCTTTGTCACCGCCCGTCATGAGGCAGAAGCGTTGGCCGTCAAGCGGCGATTCGCCAAAAAAATCGCGGATGTCTAC GCTTCGTTTGGGTTCCCGCTCCTTCACCTCGAAGTCGGCATTCAACCGGCCGAGCAGGAAATGGAGCGGTTTTTGGCGCA AAAACAGCAAGAAGATGAAGAACGAGCGCTCGCCGTGCTGACGGATTTGGCGAAAGAAGAAGAAAAAGCGGAAGCGGCTT CTCCGTCCGGCCCGCTTGTCATCGGCTATCCGATCCGCGACGAGGAGCCGGTGCGTCCGCTTGAGACGATCGTCGAGGAA GAGCGACGTGTCGTTGTGCAAGGGTATGTGTTTGACGCTGAAGTGACCGAACTCAAAAGTGGCCGTACGCTGCTGACGAT GAAAATCACGGATTATACGAACTCTATTGTCATCAAAATGTTCTCGCGTGACAAAGAAGACGCTGCACTGATGTCCAGCG TGAAAAAAGGCATGTGGGTGAAAGTGCGCGGCAGTGTGCAAAACGATACGTTCGTCCGCGATTTAGTCATTATCGCTAAT GACTTAAACGAAGTAGCGGCGAACGAACGGCGCGATACGGCACCGGAAGGCGAAAAACGGGTCGAACTCCATTTACACAC ACCGATGAGCCAAATGGATGCGGTCACTTCGGTGGCGAAGCTCATTGAACAGGCGAAAAAATGGGGGCACCCGGCGGTGG CCATCACCGACCATGCCGTCGTTCAATCGTTTCCGGAAGCGTATAGTGCGGCGAAAAAACACGGCATGAAAGTGTTGTAT GGGATGGAAGCGAACATCGTTGATGACGGGGTGCCGATCGCCTACAACGAGGCGCACCGTCGCCTTTCCGACGAGACGTA TGTTGTCTTTGACGTCGAAACGACCGGATTGTCGGCTGTATACAACACGATCATCGAGTTGGCGGCGGTGAAAGTCAAAG ACGGTGAAATCATCGATCGGTTTATGTCGTTTGCCAATCCGCACCATCCGTTATCGGTGACGACGATGGAATTGACGGGC ATTACCGATGAGATGGTGAAAGACGCCCCGGATGTCGAAGAGGTGCTTCGCCGCTTTATCGATTGGGTCGGTGACTCAAC GCTTGCCGCTCATAACGCTAGCTTTGACATCGGCTTTTTAAACGCAGGGCTCGCCAAAATGGGGCTTGGCAAAGTCATAA ACCCGGTCATCGATACACTTGAACTCGCCCGTTTTTTATATCCGGATTTGAAAAACCATCGTCTCAATACGCTTTGTAAA AAGTTTGACATTGAATTGACACAACACCACCGCGCCATTTATGACGCCGAGGCGACCGGGCATTTGCTGATGCGGCTGCT GAAAGAAGCAGAGGAACGAGGCATTTTGTATCACGATGAGTTGAACAGCCGCACGCATAGCGAAGCATCATATCGGCTAT CGCGCCCGTTTCATGTGACGTTATTGGCTCAAAACGAGACGGGGTTGAAAAATTTGTTTAAGCTCGTTTCGCTGTCACAC GTTCAATATTTTCACCGTGTGCCGCGCATTCCGCGCTCGGTGCTTGTTAAGCATCGCGATGGCTTGCTTGTCGGTTCAGG TTGCGACAAAGGGGAGCTGTTTGACAACTTGATCCAAAAGGCGCCGGAGGAAGTGGAAGAGATCGCCCGTTTTTACGATT TCCTTGAGGTGCATCCGCCAGCGGTATACAAGCCGCTGATTGAGATGGACTATGTCAAAGATGAGGAAATGATCAAAGAT ATTATTCGCAGCATCGTCGCCCTCGGCGAGAAGCTTGATATCCCGGTTGTCGCCACCGGCAACGTTCATTACTTGAATCC GGAAGATAAAATTTACCGGAAAATTTTAATTCACTCGCAAGGTGGAGCGAACCCGCTCAACCGGCACGAGCTGCCGGACG TGTATTTCCGCACAACGGATGAAATGCTTGACTGTTTTTCGTTTTTAGGGGCGGAAAAAGCGAAAGAAATCGTCGTCGAC AATACACAAAAAATCGCCTCGTTAATCGGCGAGGTGAAGCCGATTAAAGACGATTTGTATACGCCGCGCATCGAGGGAGC GGACGACGAAATCCGGGAAATGAGCTATCGGCGCGCGAAAGACATTTATGGCGATCCGCTGCCGAAGATCGTCGAAGAGC GGCTCGAAAAAGAGTTGAAAAGCATCATCGGCCACGGTTTTGCTGTTATTTATTTAATTTCTCATAAACTGGTGAAAAAA TCGCTTGATGACGGCTATCTCGTCGGTTCGCGTGGGTCGGTCGGATCGTCGTTTGTCGCGACGATGACGGAAATTACCGA AGTGAACCCGCTGCCGCCGCATTACGTCTGCCCGAACTGCAAACACTCCGAATTTTTTAATGACGGCTCAGTCGGCTCGG GCTTTGACTTGCCGGATAAAAACTGCCCGCAATGTGGGACGAAGTACAAAAAAGACGGGCACGACATCCCGTTTGAGACG TTCCTCGGCTTTAAGGGCGACAAAGTACCAGATATTGACTTGAACTTCTCGGGTGAGTACCAGCCGCGAGCCCACAACTA TACGAAAGTGTTGTTTGGTGAAGACAATGTCTATCGAGCCGGGACGATTGGCACAGTTGCTGACAAAACGGCATACGGAT TTGTCAAAGGCTATGCGAGCGACCATAACTTAGAGCTGCGCGGCGCAGAAATCGACCGGCTTGCGGCCGGCTGCACCGGG GTGAAACGGACGACCGGGCAGCATCCGGGCGGCATTATTGTCGTTCCAGATTACATGGAAATTTATGACTTTACGCCGAT TCAATATCCAGCCGATGACACGTCATCAGAGTGGCGAACAACCCACTTTGACTTTCATTCGATTCACGATAACTTGTTGA AGTTAGACATTCTTGGGCACGATGATCCGACGGTCATTCGCATGTTGCAAGATTTAAGCGGTATTGATCCGAAGACCATT CCGACCGACGACCCGGATGTGATGGGTATTTTCAGCAGCACTGAGCCGCTTGGCGTCACGCCGGAGCAAATTATGTGTAA CGTCGGCACGATTGGTATTCCGGAGTTTGGCACGCGCTTTGTTCGACAAATGTTGGAAGAAACGAAACCAAAAACGTTTT CCGAGCTCGTGCAAATTTCCGGTTTGTCGCACGGCACCGATGTCTGGCTCGGCAATGCACAAGAGCTCATCCAAAACGGG ACGTGCACGTTGTCGGAAGTGATCGGCTGCCGCGACGACATTATGGTATATCTCATTTATCGCGGGCTTGAACCGTCGCT GGCGTTTAAAATTATGGAATCGGTGCGCAAGGGGAAAGGGTTGACGCCGGAATTTGAAGAAGAAATGCGCAAGCATGACG TACCGGAGTGGTACATCGATTCGTGCAAAAAAATCAAATACATGTTCCCGAAAGCGCACGCCGCCGCCTACGTTCTCATG GCGGTGCGCATCGCCTATTTCAAAGTGCACCATCCGCTCTTGTATTACGCGTCATACTTTACGGTGCGGGCGGAAGATTT CGATCTTGATGCCATGATCAAAGGCTCAGCCGCCATCCGTAAGCGGATTGAGGAAATTAATGCCAAAGGCATCCAGGCCA CCGCGAAGGAGAAGAGCTTGCTCACTGTGCTTGAAGTAGCGCTAGAAATGTGCGAGCGCGGCTTTACCTTTAAAAATATT GACTTGTATCGTTCGCAGGCGACCGAATTTGTCATTGATGGCCATTCACTCATTCCGCCGTTTAATGCCATCCCGGGGCT CGGGACGAACGTGGCACAAAACATTGTGCGCGCCCGCGAAGAAGGGGAGTTTTTGTCGAAAGAAGATTTGCAGCAGCGTG GGAAAGTATCGAAAACACTTCTTGAGTATCTCGAAAGTCGTGGTTGCCTCGACTCACTTCCGGATCATAACCAACTGTCT CTGTTCTGA
Upstream 100 bases:
>100_bases CGTCTTTTGCAAGGATAAACGAACGGCGCCGGCGAAAAAGAACCCGCTTCTTTTTTCGCCGGCGCTGTTGCCGTTTGTAT GGTATGATAGAGAAAGAGAA
Downstream 100 bases:
>100_bases CGGAAGGTTTTTCGTTGCAATATATTTCCGAATGTGTTATAGTTTTAGTGGAATTGGCAAAGATAATGACAAGCAAAGAG TGGGGAAACCCACTCTTTCG
Product: DNA polymerase III PolC
Products: NA
Alternate protein names: PolIII [H]
Number of amino acids: Translated: 1442; Mature: 1442
Protein sequence:
>1442_residues MISLRGEVMVTKEQKERFLVLLEQLKMTSDEWMPYFREAAIRKVVIDKEEKSWHFHFQLANVLPVDVYKSFTDRLAAAFR HIAAVRHTIYVEAPHVTETDVQAYWPLCLEQLQEGVSPLVDLLSRQTPVVKGNKLFVTARHEAEALAVKRRFAKKIADVY ASFGFPLLHLEVGIQPAEQEMERFLAQKQQEDEERALAVLTDLAKEEEKAEAASPSGPLVIGYPIRDEEPVRPLETIVEE ERRVVVQGYVFDAEVTELKSGRTLLTMKITDYTNSIVIKMFSRDKEDAALMSSVKKGMWVKVRGSVQNDTFVRDLVIIAN DLNEVAANERRDTAPEGEKRVELHLHTPMSQMDAVTSVAKLIEQAKKWGHPAVAITDHAVVQSFPEAYSAAKKHGMKVLY GMEANIVDDGVPIAYNEAHRRLSDETYVVFDVETTGLSAVYNTIIELAAVKVKDGEIIDRFMSFANPHHPLSVTTMELTG ITDEMVKDAPDVEEVLRRFIDWVGDSTLAAHNASFDIGFLNAGLAKMGLGKVINPVIDTLELARFLYPDLKNHRLNTLCK KFDIELTQHHRAIYDAEATGHLLMRLLKEAEERGILYHDELNSRTHSEASYRLSRPFHVTLLAQNETGLKNLFKLVSLSH VQYFHRVPRIPRSVLVKHRDGLLVGSGCDKGELFDNLIQKAPEEVEEIARFYDFLEVHPPAVYKPLIEMDYVKDEEMIKD IIRSIVALGEKLDIPVVATGNVHYLNPEDKIYRKILIHSQGGANPLNRHELPDVYFRTTDEMLDCFSFLGAEKAKEIVVD NTQKIASLIGEVKPIKDDLYTPRIEGADDEIREMSYRRAKDIYGDPLPKIVEERLEKELKSIIGHGFAVIYLISHKLVKK SLDDGYLVGSRGSVGSSFVATMTEITEVNPLPPHYVCPNCKHSEFFNDGSVGSGFDLPDKNCPQCGTKYKKDGHDIPFET FLGFKGDKVPDIDLNFSGEYQPRAHNYTKVLFGEDNVYRAGTIGTVADKTAYGFVKGYASDHNLELRGAEIDRLAAGCTG VKRTTGQHPGGIIVVPDYMEIYDFTPIQYPADDTSSEWRTTHFDFHSIHDNLLKLDILGHDDPTVIRMLQDLSGIDPKTI PTDDPDVMGIFSSTEPLGVTPEQIMCNVGTIGIPEFGTRFVRQMLEETKPKTFSELVQISGLSHGTDVWLGNAQELIQNG TCTLSEVIGCRDDIMVYLIYRGLEPSLAFKIMESVRKGKGLTPEFEEEMRKHDVPEWYIDSCKKIKYMFPKAHAAAYVLM AVRIAYFKVHHPLLYYASYFTVRAEDFDLDAMIKGSAAIRKRIEEINAKGIQATAKEKSLLTVLEVALEMCERGFTFKNI DLYRSQATEFVIDGHSLIPPFNAIPGLGTNVAQNIVRAREEGEFLSKEDLQQRGKVSKTLLEYLESRGCLDSLPDHNQLS LF
Sequences:
>Translated_1442_residues MISLRGEVMVTKEQKERFLVLLEQLKMTSDEWMPYFREAAIRKVVIDKEEKSWHFHFQLANVLPVDVYKSFTDRLAAAFR HIAAVRHTIYVEAPHVTETDVQAYWPLCLEQLQEGVSPLVDLLSRQTPVVKGNKLFVTARHEAEALAVKRRFAKKIADVY ASFGFPLLHLEVGIQPAEQEMERFLAQKQQEDEERALAVLTDLAKEEEKAEAASPSGPLVIGYPIRDEEPVRPLETIVEE ERRVVVQGYVFDAEVTELKSGRTLLTMKITDYTNSIVIKMFSRDKEDAALMSSVKKGMWVKVRGSVQNDTFVRDLVIIAN DLNEVAANERRDTAPEGEKRVELHLHTPMSQMDAVTSVAKLIEQAKKWGHPAVAITDHAVVQSFPEAYSAAKKHGMKVLY GMEANIVDDGVPIAYNEAHRRLSDETYVVFDVETTGLSAVYNTIIELAAVKVKDGEIIDRFMSFANPHHPLSVTTMELTG ITDEMVKDAPDVEEVLRRFIDWVGDSTLAAHNASFDIGFLNAGLAKMGLGKVINPVIDTLELARFLYPDLKNHRLNTLCK KFDIELTQHHRAIYDAEATGHLLMRLLKEAEERGILYHDELNSRTHSEASYRLSRPFHVTLLAQNETGLKNLFKLVSLSH VQYFHRVPRIPRSVLVKHRDGLLVGSGCDKGELFDNLIQKAPEEVEEIARFYDFLEVHPPAVYKPLIEMDYVKDEEMIKD IIRSIVALGEKLDIPVVATGNVHYLNPEDKIYRKILIHSQGGANPLNRHELPDVYFRTTDEMLDCFSFLGAEKAKEIVVD NTQKIASLIGEVKPIKDDLYTPRIEGADDEIREMSYRRAKDIYGDPLPKIVEERLEKELKSIIGHGFAVIYLISHKLVKK SLDDGYLVGSRGSVGSSFVATMTEITEVNPLPPHYVCPNCKHSEFFNDGSVGSGFDLPDKNCPQCGTKYKKDGHDIPFET FLGFKGDKVPDIDLNFSGEYQPRAHNYTKVLFGEDNVYRAGTIGTVADKTAYGFVKGYASDHNLELRGAEIDRLAAGCTG VKRTTGQHPGGIIVVPDYMEIYDFTPIQYPADDTSSEWRTTHFDFHSIHDNLLKLDILGHDDPTVIRMLQDLSGIDPKTI PTDDPDVMGIFSSTEPLGVTPEQIMCNVGTIGIPEFGTRFVRQMLEETKPKTFSELVQISGLSHGTDVWLGNAQELIQNG TCTLSEVIGCRDDIMVYLIYRGLEPSLAFKIMESVRKGKGLTPEFEEEMRKHDVPEWYIDSCKKIKYMFPKAHAAAYVLM AVRIAYFKVHHPLLYYASYFTVRAEDFDLDAMIKGSAAIRKRIEEINAKGIQATAKEKSLLTVLEVALEMCERGFTFKNI DLYRSQATEFVIDGHSLIPPFNAIPGLGTNVAQNIVRAREEGEFLSKEDLQQRGKVSKTLLEYLESRGCLDSLPDHNQLS LF >Mature_1442_residues MISLRGEVMVTKEQKERFLVLLEQLKMTSDEWMPYFREAAIRKVVIDKEEKSWHFHFQLANVLPVDVYKSFTDRLAAAFR HIAAVRHTIYVEAPHVTETDVQAYWPLCLEQLQEGVSPLVDLLSRQTPVVKGNKLFVTARHEAEALAVKRRFAKKIADVY ASFGFPLLHLEVGIQPAEQEMERFLAQKQQEDEERALAVLTDLAKEEEKAEAASPSGPLVIGYPIRDEEPVRPLETIVEE ERRVVVQGYVFDAEVTELKSGRTLLTMKITDYTNSIVIKMFSRDKEDAALMSSVKKGMWVKVRGSVQNDTFVRDLVIIAN DLNEVAANERRDTAPEGEKRVELHLHTPMSQMDAVTSVAKLIEQAKKWGHPAVAITDHAVVQSFPEAYSAAKKHGMKVLY GMEANIVDDGVPIAYNEAHRRLSDETYVVFDVETTGLSAVYNTIIELAAVKVKDGEIIDRFMSFANPHHPLSVTTMELTG ITDEMVKDAPDVEEVLRRFIDWVGDSTLAAHNASFDIGFLNAGLAKMGLGKVINPVIDTLELARFLYPDLKNHRLNTLCK KFDIELTQHHRAIYDAEATGHLLMRLLKEAEERGILYHDELNSRTHSEASYRLSRPFHVTLLAQNETGLKNLFKLVSLSH VQYFHRVPRIPRSVLVKHRDGLLVGSGCDKGELFDNLIQKAPEEVEEIARFYDFLEVHPPAVYKPLIEMDYVKDEEMIKD IIRSIVALGEKLDIPVVATGNVHYLNPEDKIYRKILIHSQGGANPLNRHELPDVYFRTTDEMLDCFSFLGAEKAKEIVVD NTQKIASLIGEVKPIKDDLYTPRIEGADDEIREMSYRRAKDIYGDPLPKIVEERLEKELKSIIGHGFAVIYLISHKLVKK SLDDGYLVGSRGSVGSSFVATMTEITEVNPLPPHYVCPNCKHSEFFNDGSVGSGFDLPDKNCPQCGTKYKKDGHDIPFET FLGFKGDKVPDIDLNFSGEYQPRAHNYTKVLFGEDNVYRAGTIGTVADKTAYGFVKGYASDHNLELRGAEIDRLAAGCTG VKRTTGQHPGGIIVVPDYMEIYDFTPIQYPADDTSSEWRTTHFDFHSIHDNLLKLDILGHDDPTVIRMLQDLSGIDPKTI PTDDPDVMGIFSSTEPLGVTPEQIMCNVGTIGIPEFGTRFVRQMLEETKPKTFSELVQISGLSHGTDVWLGNAQELIQNG TCTLSEVIGCRDDIMVYLIYRGLEPSLAFKIMESVRKGKGLTPEFEEEMRKHDVPEWYIDSCKKIKYMFPKAHAAAYVLM AVRIAYFKVHHPLLYYASYFTVRAEDFDLDAMIKGSAAIRKRIEEINAKGIQATAKEKSLLTVLEVALEMCERGFTFKNI DLYRSQATEFVIDGHSLIPPFNAIPGLGTNVAQNIVRAREEGEFLSKEDLQQRGKVSKTLLEYLESRGCLDSLPDHNQLS LF
Specific function: Required for replicative DNA synthesis. This DNA polymerase also exhibits 3' to 5' exonuclease activity [H]
COG id: COG2176
COG function: function code L; DNA polymerase III, alpha subunit (gram-positive type)
Gene ontology:
Cell location: Cytoplasm [H]
Metaboloic importance: Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 1 exonuclease domain [H]
Homologues:
Organism=Escherichia coli, GI1786381, Length=925, Percent_Identity=22.8108108108108, Blast_Score=131, Evalue=3e-31, Organism=Escherichia coli, GI1788149, Length=166, Percent_Identity=31.3253012048193, Blast_Score=78, Evalue=4e-15, Organism=Escherichia coli, GI1786409, Length=162, Percent_Identity=31.4814814814815, Blast_Score=75, Evalue=3e-14,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR011708 - InterPro: IPR006054 - InterPro: IPR006055 - InterPro: IPR013520 - InterPro: IPR016027 - InterPro: IPR004365 - InterPro: IPR004013 - InterPro: IPR003141 - InterPro: IPR006308 - InterPro: IPR012337 [H]
Pfam domain/function: PF07733 DNA_pol3_alpha; PF00929 Exonuc_X-T; PF02811 PHP; PF01336 tRNA_anti [H]
EC number: =2.7.7.7 [H]
Molecular weight: Translated: 162652; Mature: 162652
Theoretical pI: Translated: 5.56; Mature: 5.56
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.0 %Cys (Translated Protein) 2.4 %Met (Translated Protein) 3.5 %Cys+Met (Translated Protein) 1.0 %Cys (Mature Protein) 2.4 %Met (Mature Protein) 3.5 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MISLRGEVMVTKEQKERFLVLLEQLKMTSDEWMPYFREAAIRKVVIDKEEKSWHFHFQLA CCCCCCCEEEEHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHCCCCCCCEEEEEEEC NVLPVDVYKSFTDRLAAAFRHIAAVRHTIYVEAPHVTETDVQAYWPLCLEQLQEGVSPLV CCCHHHHHHHHHHHHHHHHHHHHHHHHEEEEECCCCCCCHHHHHHHHHHHHHHHHHHHHH DLLSRQTPVVKGNKLFVTARHEAEALAVKRRFAKKIADVYASFGFPLLHLEVGIQPAEQE HHHCCCCCEEECCEEEEEECCHHHHHHHHHHHHHHHHHHHHHCCCEEEEEEECCCCHHHH MERFLAQKQQEDEERALAVLTDLAKEEEKAEAASPSGPLVIGYPIRDEEPVRPLETIVEE HHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHCCCCCCCEEEEECCCCCCCCCHHHHHHHH ERRVVVQGYVFDAEVTELKSGRTLLTMKITDYTNSIVIKMFSRDKEDAALMSSVKKGMWV HCEEEEEEEEECCHHHHHCCCCEEEEEEECCCCCEEEEEEECCCCHHHHHHHHHHCCCEE KVRGSVQNDTFVRDLVIIANDLNEVAANERRDTAPEGEKRVELHLHTPMSQMDAVTSVAK EEECCCCCCHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCEEEEEEECCHHHHHHHHHHHH LIEQAKKWGHPAVAITDHAVVQSFPEAYSAAKKHGMKVLYGMEANIVDDGVPIAYNEAHR HHHHHHHCCCCEEEEECHHHHHHHHHHHHHHHHCCCEEEEECCCCCCCCCCCEEEHHHHH RLSDETYVVFDVETTGLSAVYNTIIELAAVKVKDGEIIDRFMSFANPHHPLSVTTMELTG HCCCCEEEEEEECCCCHHHHHHHHHHHHHEEECCHHHHHHHHHHCCCCCCCEEEEEEECC ITDEMVKDAPDVEEVLRRFIDWVGDSTLAAHNASFDIGFLNAGLAKMGLGKVINPVIDTL CCHHHHHCCCCHHHHHHHHHHHHCCCCEEECCCCCEEHHHHCCHHHHHHHHHHHHHHHHH ELARFLYPDLKNHRLNTLCKKFDIELTQHHRAIYDAEATGHLLMRLLKEAEERGILYHDE HHHHHHCCCCCCCHHHHHHHHHCCHHHHHHHHHHCCCHHHHHHHHHHHHHHHCCCEEECC LNSRTHSEASYRLSRPFHVTLLAQNETGLKNLFKLVSLSHVQYFHRVPRIPRSVLVKHRD CCCCCCCCHHHEECCCEEEEEEECCCCCHHHHHHHHHHHHHHHHHHCCCCCHHHHHHCCC GLLVGSGCDKGELFDNLIQKAPEEVEEIARFYDFLEVHPPAVYKPLIEMDYVKDEEMIKD CEEECCCCCCHHHHHHHHHHCHHHHHHHHHHHHHHHCCCCHHHHHHHHHHCCCCHHHHHH IIRSIVALGEKLDIPVVATGNVHYLNPEDKIYRKILIHSQGGANPLNRHELPDVYFRTTD HHHHHHHCCCCCCCCEEECCCEEEECCHHHHHHHHHEECCCCCCCCCCCCCCCHHHCCHH EMLDCFSFLGAEKAKEIVVDNTQKIASLIGEVKPIKDDLYTPRIEGADDEIREMSYRRAK HHHHHHHHHCHHHHHHHHHCCHHHHHHHHHCCCCCHHHCCCCCCCCCCHHHHHHHHHHHH DIYGDPLPKIVEERLEKELKSIIGHGFAVIYLISHKLVKKSLDDGYLVGSRGSVGSSFVA HCCCCCCHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHCCCCCEEECCCCCCCHHHHH TMTEITEVNPLPPHYVCPNCKHSEFFNDGSVGSGFDLPDKNCPQCGTKYKKDGHDIPFET HHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHH FLGFKGDKVPDIDLNFSGEYQPRAHNYTKVLFGEDNVYRAGTIGTVADKTAYGFVKGYAS HCCCCCCCCCCCCCCCCCCCCCCCCCCEEEEECCCCEEECCCCCCHHHHHHHHHHCCCCC DHNLELRGAEIDRLAAGCTGVKRTTGQHPGGIIVVPDYMEIYDFTPIQYPADDTSSEWRT CCCEEEECCHHHHHHHCCCCCCCCCCCCCCCEEECCCHHHHHCCCCCCCCCCCCCCCCEE THFDFHSIHDNLLKLDILGHDDPTVIRMLQDLSGIDPKTIPTDDPDVMGIFSSTEPLGVT EECCHHHHCCCEEEEEEECCCCHHHHHHHHHHCCCCCCCCCCCCCCEEEEECCCCCCCCC PEQIMCNVGTIGIPEFGTRFVRQMLEETKPKTFSELVQISGLSHGTDVWLGNAQELIQNG HHHHHCCCCCCCCCHHHHHHHHHHHHHCCCHHHHHHHHHCCCCCCCCEEECCHHHHHCCC TCTLSEVIGCRDDIMVYLIYRGLEPSLAFKIMESVRKGKGLTPEFEEEMRKHDVPEWYID CCCHHHHHCCCHHHEEEEHHHCCCHHHHHHHHHHHHHCCCCCCHHHHHHHHCCCCHHHHH SCKKIKYMFPKAHAAAYVLMAVRIAYFKVHHPLLYYASYFTVRAEDFDLDAMIKGSAAIR HHHHHHHHCCHHHHHHHHHHHHHHHHHHHHCHHHHHHHEEEEEECCCCCHHHCCCHHHHH KRIEEINAKGIQATAKEKSLLTVLEVALEMCERGFTFKNIDLYRSQATEFVIDGHSLIPP HHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHCCCEEEECCCCCCCC FNAIPGLGTNVAQNIVRAREEGEFLSKEDLQQRGKVSKTLLEYLESRGCLDSLPDHNQLS CCCCCCCCHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHCCCHHCCCCCCCCC LF CC >Mature Secondary Structure MISLRGEVMVTKEQKERFLVLLEQLKMTSDEWMPYFREAAIRKVVIDKEEKSWHFHFQLA CCCCCCCEEEEHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHCCCCCCCEEEEEEEC NVLPVDVYKSFTDRLAAAFRHIAAVRHTIYVEAPHVTETDVQAYWPLCLEQLQEGVSPLV CCCHHHHHHHHHHHHHHHHHHHHHHHHEEEEECCCCCCCHHHHHHHHHHHHHHHHHHHHH DLLSRQTPVVKGNKLFVTARHEAEALAVKRRFAKKIADVYASFGFPLLHLEVGIQPAEQE HHHCCCCCEEECCEEEEEECCHHHHHHHHHHHHHHHHHHHHHCCCEEEEEEECCCCHHHH MERFLAQKQQEDEERALAVLTDLAKEEEKAEAASPSGPLVIGYPIRDEEPVRPLETIVEE HHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHCCCCCCCEEEEECCCCCCCCCHHHHHHHH ERRVVVQGYVFDAEVTELKSGRTLLTMKITDYTNSIVIKMFSRDKEDAALMSSVKKGMWV HCEEEEEEEEECCHHHHHCCCCEEEEEEECCCCCEEEEEEECCCCHHHHHHHHHHCCCEE KVRGSVQNDTFVRDLVIIANDLNEVAANERRDTAPEGEKRVELHLHTPMSQMDAVTSVAK EEECCCCCCHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCEEEEEEECCHHHHHHHHHHHH LIEQAKKWGHPAVAITDHAVVQSFPEAYSAAKKHGMKVLYGMEANIVDDGVPIAYNEAHR HHHHHHHCCCCEEEEECHHHHHHHHHHHHHHHHCCCEEEEECCCCCCCCCCCEEEHHHHH RLSDETYVVFDVETTGLSAVYNTIIELAAVKVKDGEIIDRFMSFANPHHPLSVTTMELTG HCCCCEEEEEEECCCCHHHHHHHHHHHHHEEECCHHHHHHHHHHCCCCCCCEEEEEEECC ITDEMVKDAPDVEEVLRRFIDWVGDSTLAAHNASFDIGFLNAGLAKMGLGKVINPVIDTL CCHHHHHCCCCHHHHHHHHHHHHCCCCEEECCCCCEEHHHHCCHHHHHHHHHHHHHHHHH ELARFLYPDLKNHRLNTLCKKFDIELTQHHRAIYDAEATGHLLMRLLKEAEERGILYHDE HHHHHHCCCCCCCHHHHHHHHHCCHHHHHHHHHHCCCHHHHHHHHHHHHHHHCCCEEECC LNSRTHSEASYRLSRPFHVTLLAQNETGLKNLFKLVSLSHVQYFHRVPRIPRSVLVKHRD CCCCCCCCHHHEECCCEEEEEEECCCCCHHHHHHHHHHHHHHHHHHCCCCCHHHHHHCCC GLLVGSGCDKGELFDNLIQKAPEEVEEIARFYDFLEVHPPAVYKPLIEMDYVKDEEMIKD CEEECCCCCCHHHHHHHHHHCHHHHHHHHHHHHHHHCCCCHHHHHHHHHHCCCCHHHHHH IIRSIVALGEKLDIPVVATGNVHYLNPEDKIYRKILIHSQGGANPLNRHELPDVYFRTTD HHHHHHHCCCCCCCCEEECCCEEEECCHHHHHHHHHEECCCCCCCCCCCCCCCHHHCCHH EMLDCFSFLGAEKAKEIVVDNTQKIASLIGEVKPIKDDLYTPRIEGADDEIREMSYRRAK HHHHHHHHHCHHHHHHHHHCCHHHHHHHHHCCCCCHHHCCCCCCCCCCHHHHHHHHHHHH DIYGDPLPKIVEERLEKELKSIIGHGFAVIYLISHKLVKKSLDDGYLVGSRGSVGSSFVA HCCCCCCHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHCCCCCEEECCCCCCCHHHHH TMTEITEVNPLPPHYVCPNCKHSEFFNDGSVGSGFDLPDKNCPQCGTKYKKDGHDIPFET HHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHH FLGFKGDKVPDIDLNFSGEYQPRAHNYTKVLFGEDNVYRAGTIGTVADKTAYGFVKGYAS HCCCCCCCCCCCCCCCCCCCCCCCCCCEEEEECCCCEEECCCCCCHHHHHHHHHHCCCCC DHNLELRGAEIDRLAAGCTGVKRTTGQHPGGIIVVPDYMEIYDFTPIQYPADDTSSEWRT CCCEEEECCHHHHHHHCCCCCCCCCCCCCCCEEECCCHHHHHCCCCCCCCCCCCCCCCEE THFDFHSIHDNLLKLDILGHDDPTVIRMLQDLSGIDPKTIPTDDPDVMGIFSSTEPLGVT EECCHHHHCCCEEEEEEECCCCHHHHHHHHHHCCCCCCCCCCCCCCEEEEECCCCCCCCC PEQIMCNVGTIGIPEFGTRFVRQMLEETKPKTFSELVQISGLSHGTDVWLGNAQELIQNG HHHHHCCCCCCCCCHHHHHHHHHHHHHCCCHHHHHHHHHCCCCCCCCEEECCHHHHHCCC TCTLSEVIGCRDDIMVYLIYRGLEPSLAFKIMESVRKGKGLTPEFEEEMRKHDVPEWYID CCCHHHHHCCCHHHEEEEHHHCCCHHHHHHHHHHHHHCCCCCCHHHHHHHHCCCCHHHHH SCKKIKYMFPKAHAAAYVLMAVRIAYFKVHHPLLYYASYFTVRAEDFDLDAMIKGSAAIR HHHHHHHHCCHHHHHHHHHHHHHHHHHHHHCHHHHHHHEEEEEECCCCCHHHCCCHHHHH KRIEEINAKGIQATAKEKSLLTVLEVALEMCERGFTFKNIDLYRSQATEFVIDGHSLIPP HHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHCCCEEEECCCCCCCC FNAIPGLGTNVAQNIVRAREEGEFLSKEDLQQRGKVSKTLLEYLESRGCLDSLPDHNQLS CCCCCCCCHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHCCCHHCCCCCCCCC LF CC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 1901559; 2499883; 1840638; 9384377; 7679775; 2515995; 8491709; 1312503 [H]