Definition Vibrio cholerae M66-2 chromosome I, complete genome.
Accession NC_012578
Length 2,892,523

Click here to switch to the map view.

The map label for this gene is rpoC

Identifier: 227080541

GI number: 227080541

Start: 329230

End: 333435

Strand: Direct

Name: rpoC

Synonym: VCM66_0313

Alternate gene names: 227080541

Gene position: 329230-333435 (Clockwise)

Preceding gene: 227080540

Following gene: 227080543

Centisome position: 11.38

GC content: 50.62

Gene sequence:

>4206_bases
GTGAAAGACTTATTAAACTTTCTAAAAGCACAGCATAAGACCGAAGAATTTGATGCGATCAAAATCGGTCTGGCTTCACC
AGACATGATCCGTTCATGGTCTTTTGGTGAAGTGAAAAAACCTGAAACCATCAACTATCGTACGTTCAAGCCTGAGCGTG
ATGGTCTGTTCTGTGCGCGTATTTTTGGCCCGGTAAAAGACTACGAATGTCTTTGTGGCAAATATAAGCGTCTGAAACAC
CGTGGTGTGATTTGTGAGAAGTGTGGCGTTGAAGTCACCCAAACTAAAGTTCGTCGTGACCGTATGGGCCACATCGAACT
GGCTTCTCCAGTTGCGCACATCTGGTTCCTGAAGTCTCTGCCATCTCGTATCGGTCTACTGATGGACATGCCTCTGCGTG
ACATCGAACGCGTACTTTACTTTGAAATGTACGTAGTGACTGAGCCAGGCATGACTGACCTTGAACGTGGTCAAATGCTG
ACTGAGGAAGAGTACCTCGACCGTTTGGAAGAGTGGGGCGATGAGTTCACCGCGAAAATGGGTGCTGAAGCGATCAAAGA
TCTGCTGGCATCGATGGATCTGCCTGCAGAAGCAGAGCAGATGCGCGAAGAGCTGGATACCACTAACTCTGAAACCAAAC
GTAAGAAACTGACTAAGCGTCTGAAGCTGGTTGAAGCGTTCGTCGCATCAGGTAACAAACCTGAATGGATGATCCTGACT
GTACTACCAGTTCTGCCGCCTGATCTACGTCCATTGGTTCCACTGGATGGCGGTCGTTTCGCAACGTCGGATCTGAACGA
TCTGTACCGTCGCGTCATCAACCGTAACAACCGTTTGAAGCGTCTGCTTGAACTGGCGGCACCAGACATCATCGTACGTA
ACGAAAAACGTATGCTGCAAGAGTCTGTGGATGCGCTGCTGGATAACGGCCGTCGTGGTCGTGCGATCACGGGCTCGAAC
AAGCGTCCGCTGAAGTCTCTGGCTGACATGATCAAAGGTAAGCAAGGTCGTTTCCGTCAGAACCTGCTGGGTAAACGTGT
TGACTACTCAGGCCGTTCGGTTATCACCGTAGGTCCATACCTGCGTCTGCACCAGTGTGGTCTACCGAAGAAAATGGCTC
TTGAGCTGTTCAAACCATTCATCTACAGCAAGCTGGAAACTCGTGGCCTAGCAACGACGATCAAAGCCGCTAAGAAAATG
GTTGAGCGCGAAGAAGCGGTCGTATGGGATATCTTGGATGAAGTGATCCGCGAACACCCAGTGCTGCTGAACCGTGCACC
AACACTTCACCGTTTGGGTATCCAAGCGTTTGAACCGGTCCTGATCGAAGGTAAAGCGATCCAACTGCACCCACTAGTGT
GTGCGGCGTATAACGCGGACTTCGACGGTGACCAAATGGCGGTACACGTTCCTCTGACGCTTGAAGCGCAGTTGGAAGCT
CGTACCCTGATGATGTCAACCAACAACATTCTGTCGCCAGCGTCAGGTGATCCAATCATCGTACCGTCTCAGGACGTGGT
ACTGGGTCTGTACTACATGACCCGTGAAAAGATCAATGCGAAAGGCGAAGGTATGTACCTGACTGGTCCTGCTGAGGCTG
AGAAGGCGTACCGTACTAAGACTGCTGAGCTGCACGCTCGCGTTAAAGTACGTATTACCGAAACCATCAAGCATGAAAAC
GGTAAGCTGACCACTGAAACCAAGATGATTGACACGACCGTTGGCCGTGCCATGTTGTGGCAAATCGTACCGAAAGGTCT
GCCATACAGCTTGGTGAACCAGAAGTTAGGTAAGAAGCAAATTTCTAACCTGCTCAACGAGGCATACCGTAAGCTGGGTC
TGAAAGACACCGTTATCTTCGCTGACCAAATCATGTACACCGGTTTCGCTTACGCGGCACTGTCTGGTGTATCGGTTGGT
ATCGACGATATGGTAGTTCCAGCGGCTAAGTACACGGAAATTGCTGAAGCGGAAGAAGAAGTACGCGAAATTCAAGAGCA
GTTCCAGTCTGGTCTGGTGACCGCTGGCGAACGCTACAACAAAGTGATCGACATTTGGGCATCAACCAACGATCGCGTAG
CGAAAGCGATGATGGAAAACCTCTCTTCTGAGCAGGTGATTAACCGTCAAGGCGAACAAGAAAAACAAGAGTCGTTCAAC
AGCATCTATATGATGGCCGACTCAGGTGCTCGTGGTTCTGCTGCTCAGATCCGTCAGTTGGCGGGTATGCGTGGTCTGAT
GGCGCGTCCAGATGGCTCGATCATCGAAACGCCAATCACGGCAAACTTTAAAGAAGGTCTAAACGTTCTTCAGTACTTTA
TCTCAACGCACGGTGCTCGTAAGGGTCTGGCGGATACGGCACTGAAAACAGCGAACTCCGGTTACCTGACTCGTCGTCTG
GTAGACGTAGCGCAAGACGTTGTGGTGACTGAACATGACTGTGGCACCCTAGAAGGCGTGGTGATGACACCGCACATCGA
AGGTGGTGACGTTAAAGTCGCACTGACTGAACTGGCACTGGGCCGTGTGGTATCAGAAGATATCCTCAAGCCAGGTACAG
ATGAAGTGTTGATCCCTCGTAATACACTGCTGGATGAAAAGTGGTGTAAGGTGATCAACGATAACTCTGTTGACCAAATC
AAAGTACGTTCAGTGGTAACTTGTGATTCTGACTTCGGTTGTTGTGCGCAGTGTTACGGTCGTGACCTAGCACGTGGTCA
CTTGGTGAACCAAGGTGAAGCGGTCGGTGTTATAGCGGCACAGTCAATCGGTGAGCCAGGTACACAGCTGACGATGCGTA
CGTTCCACATCGGTGGTGCGGCATCAACAGCAGCAGCAGAAAACAGCATCCAAGCTAAGAACAACGGTTCTGTGAAACTG
CACAATGCGAAGTTCGTAACCAATAAAGATGGCAAGCTCGTTATCACCTCTCGTGCTTCTGAGCTGACCATCATTGACGA
ATTTGGTCGTACCAAAGAGAAACACAAACTGCCATACGGCTCTATGCTGAGCAAAGCCGATGGTGATGCAGTGGCTGCGG
GCGAAACCGTAGCGAACTGGGAAGCGCATACCATGCCAATCATCACTGAAGTGGCAGGTCGCGTACAGTTTGTGGATATG
ATCGATGGCGTAACCGTTTCTCGTCAAACGGACGATCTGACTGGTCTGTCTTCAAGTGAAGTGACTGAAGCCGCAGCGCG
TCCTGCAGCAGGTAAAGACATGCGTCCAGCCATTAAACTGGTTGACGCAAATGGTAAAGATGTCCTGATCCCAGGTACTG
ACATGCCAGCTCAATACTTCCTGCCAGGTAAAGCGATTGTGAACTTGGACGACGGTGCTGAAGTGAATGTGGGTGATACA
CTGGCTCGTATTCCTCAGAAGTCTGGCGGTAACAAGGACATCACCGGTGGTCTACCACGCGTTGCTGACCTGTTTGAAGC
GCGTAAGCCAAAAGAGCCTGCGATTCTGGCTGAGCACTCAGGTACCGTATCGTTCGGTAAAGAGACTAAAGGTAAGCGTC
GTTTGATCATCACTCGTGACAGCGGTGACACTTACGAAGAGATGATCCCTAAACATCGTCAATTGAACGTGTTTGAAGGT
GAGCGCATTGAGCGTGGTGATGTGATTGCGGACGGCCCAGAGTCGCCACATGACATCCTGCGTCTGCGTGGGATCCATGC
AGTGACCACTTACATCGCGAACGAGGTTCAGGAAGTTTACCGTCTACAAGGCGTTAAGATTAACGATAAGCACATCGAGA
CTATCGTTCGTCAAATGCTGCGTAAGTGTACGATCACCTTCGCGGGTGACTCAGAGTTCTTGCCTGGCGAGACAGTTGAG
TACTCACAAGTGAAGATCGCGAACCGTAAACTGGTTGAAGAAGGCAAAGAGCCAGCTCGTTTCGAGCGTGAGTTGTTGGG
TATTACCAAAGCATCTCTGGCGACTGAGTCTTTCATCTCAGCAGCATCGTTCCAAGAAACCACTCGCGTTCTAACGGAAG
CAGCGGTATCTGGTAAGCGTGACGATCTGCGCGGTCTGAAAGAGAACGTGATCGTTGGCCGTCTGATCCCGGCTGGTACA
GGTTTTGCGTACCACCAAGATCGTCAAGCCAAACGTGCACAAGAACAGCAAGGTCCATCGGCTGAACAAGCCACTGACAA
CCTCGCTGCACTGTTGAATGCAGGTTTCTCTTCTGACGACGAGTAA

Upstream 100 bases:

>100_bases
CCCTAAGGTTTCCCCGCAAGGGGAAGCCTACCGGTTTCGGTAGGAAGGTGCTCGTTGCCAATCGCAGCGAGTTCCTTTTA
ACTCCTTACAGGAGCTGAAT

Downstream 100 bases:

>100_bases
GTCATAGTCATCAAGCTATGAAAAAAGGCACCTTAAGGTGCCTTTTTTATTGGTCTATTTTTTACATTCATCTTCGCAGC
GGAAATCACCGATTGAAAAC

Product: DNA-directed RNA polymerase subunit beta'

Products: NA

Alternate protein names: RNAP subunit beta'; RNA polymerase subunit beta'; Transcriptase subunit beta'

Number of amino acids: Translated: 1401; Mature: 1401

Protein sequence:

>1401_residues
MKDLLNFLKAQHKTEEFDAIKIGLASPDMIRSWSFGEVKKPETINYRTFKPERDGLFCARIFGPVKDYECLCGKYKRLKH
RGVICEKCGVEVTQTKVRRDRMGHIELASPVAHIWFLKSLPSRIGLLMDMPLRDIERVLYFEMYVVTEPGMTDLERGQML
TEEEYLDRLEEWGDEFTAKMGAEAIKDLLASMDLPAEAEQMREELDTTNSETKRKKLTKRLKLVEAFVASGNKPEWMILT
VLPVLPPDLRPLVPLDGGRFATSDLNDLYRRVINRNNRLKRLLELAAPDIIVRNEKRMLQESVDALLDNGRRGRAITGSN
KRPLKSLADMIKGKQGRFRQNLLGKRVDYSGRSVITVGPYLRLHQCGLPKKMALELFKPFIYSKLETRGLATTIKAAKKM
VEREEAVVWDILDEVIREHPVLLNRAPTLHRLGIQAFEPVLIEGKAIQLHPLVCAAYNADFDGDQMAVHVPLTLEAQLEA
RTLMMSTNNILSPASGDPIIVPSQDVVLGLYYMTREKINAKGEGMYLTGPAEAEKAYRTKTAELHARVKVRITETIKHEN
GKLTTETKMIDTTVGRAMLWQIVPKGLPYSLVNQKLGKKQISNLLNEAYRKLGLKDTVIFADQIMYTGFAYAALSGVSVG
IDDMVVPAAKYTEIAEAEEEVREIQEQFQSGLVTAGERYNKVIDIWASTNDRVAKAMMENLSSEQVINRQGEQEKQESFN
SIYMMADSGARGSAAQIRQLAGMRGLMARPDGSIIETPITANFKEGLNVLQYFISTHGARKGLADTALKTANSGYLTRRL
VDVAQDVVVTEHDCGTLEGVVMTPHIEGGDVKVALTELALGRVVSEDILKPGTDEVLIPRNTLLDEKWCKVINDNSVDQI
KVRSVVTCDSDFGCCAQCYGRDLARGHLVNQGEAVGVIAAQSIGEPGTQLTMRTFHIGGAASTAAAENSIQAKNNGSVKL
HNAKFVTNKDGKLVITSRASELTIIDEFGRTKEKHKLPYGSMLSKADGDAVAAGETVANWEAHTMPIITEVAGRVQFVDM
IDGVTVSRQTDDLTGLSSSEVTEAAARPAAGKDMRPAIKLVDANGKDVLIPGTDMPAQYFLPGKAIVNLDDGAEVNVGDT
LARIPQKSGGNKDITGGLPRVADLFEARKPKEPAILAEHSGTVSFGKETKGKRRLIITRDSGDTYEEMIPKHRQLNVFEG
ERIERGDVIADGPESPHDILRLRGIHAVTTYIANEVQEVYRLQGVKINDKHIETIVRQMLRKCTITFAGDSEFLPGETVE
YSQVKIANRKLVEEGKEPARFERELLGITKASLATESFISAASFQETTRVLTEAAVSGKRDDLRGLKENVIVGRLIPAGT
GFAYHQDRQAKRAQEQQGPSAEQATDNLAALLNAGFSSDDE

Sequences:

>Translated_1401_residues
MKDLLNFLKAQHKTEEFDAIKIGLASPDMIRSWSFGEVKKPETINYRTFKPERDGLFCARIFGPVKDYECLCGKYKRLKH
RGVICEKCGVEVTQTKVRRDRMGHIELASPVAHIWFLKSLPSRIGLLMDMPLRDIERVLYFEMYVVTEPGMTDLERGQML
TEEEYLDRLEEWGDEFTAKMGAEAIKDLLASMDLPAEAEQMREELDTTNSETKRKKLTKRLKLVEAFVASGNKPEWMILT
VLPVLPPDLRPLVPLDGGRFATSDLNDLYRRVINRNNRLKRLLELAAPDIIVRNEKRMLQESVDALLDNGRRGRAITGSN
KRPLKSLADMIKGKQGRFRQNLLGKRVDYSGRSVITVGPYLRLHQCGLPKKMALELFKPFIYSKLETRGLATTIKAAKKM
VEREEAVVWDILDEVIREHPVLLNRAPTLHRLGIQAFEPVLIEGKAIQLHPLVCAAYNADFDGDQMAVHVPLTLEAQLEA
RTLMMSTNNILSPASGDPIIVPSQDVVLGLYYMTREKINAKGEGMYLTGPAEAEKAYRTKTAELHARVKVRITETIKHEN
GKLTTETKMIDTTVGRAMLWQIVPKGLPYSLVNQKLGKKQISNLLNEAYRKLGLKDTVIFADQIMYTGFAYAALSGVSVG
IDDMVVPAAKYTEIAEAEEEVREIQEQFQSGLVTAGERYNKVIDIWASTNDRVAKAMMENLSSEQVINRQGEQEKQESFN
SIYMMADSGARGSAAQIRQLAGMRGLMARPDGSIIETPITANFKEGLNVLQYFISTHGARKGLADTALKTANSGYLTRRL
VDVAQDVVVTEHDCGTLEGVVMTPHIEGGDVKVALTELALGRVVSEDILKPGTDEVLIPRNTLLDEKWCKVINDNSVDQI
KVRSVVTCDSDFGCCAQCYGRDLARGHLVNQGEAVGVIAAQSIGEPGTQLTMRTFHIGGAASTAAAENSIQAKNNGSVKL
HNAKFVTNKDGKLVITSRASELTIIDEFGRTKEKHKLPYGSMLSKADGDAVAAGETVANWEAHTMPIITEVAGRVQFVDM
IDGVTVSRQTDDLTGLSSSEVTEAAARPAAGKDMRPAIKLVDANGKDVLIPGTDMPAQYFLPGKAIVNLDDGAEVNVGDT
LARIPQKSGGNKDITGGLPRVADLFEARKPKEPAILAEHSGTVSFGKETKGKRRLIITRDSGDTYEEMIPKHRQLNVFEG
ERIERGDVIADGPESPHDILRLRGIHAVTTYIANEVQEVYRLQGVKINDKHIETIVRQMLRKCTITFAGDSEFLPGETVE
YSQVKIANRKLVEEGKEPARFERELLGITKASLATESFISAASFQETTRVLTEAAVSGKRDDLRGLKENVIVGRLIPAGT
GFAYHQDRQAKRAQEQQGPSAEQATDNLAALLNAGFSSDDE
>Mature_1401_residues
MKDLLNFLKAQHKTEEFDAIKIGLASPDMIRSWSFGEVKKPETINYRTFKPERDGLFCARIFGPVKDYECLCGKYKRLKH
RGVICEKCGVEVTQTKVRRDRMGHIELASPVAHIWFLKSLPSRIGLLMDMPLRDIERVLYFEMYVVTEPGMTDLERGQML
TEEEYLDRLEEWGDEFTAKMGAEAIKDLLASMDLPAEAEQMREELDTTNSETKRKKLTKRLKLVEAFVASGNKPEWMILT
VLPVLPPDLRPLVPLDGGRFATSDLNDLYRRVINRNNRLKRLLELAAPDIIVRNEKRMLQESVDALLDNGRRGRAITGSN
KRPLKSLADMIKGKQGRFRQNLLGKRVDYSGRSVITVGPYLRLHQCGLPKKMALELFKPFIYSKLETRGLATTIKAAKKM
VEREEAVVWDILDEVIREHPVLLNRAPTLHRLGIQAFEPVLIEGKAIQLHPLVCAAYNADFDGDQMAVHVPLTLEAQLEA
RTLMMSTNNILSPASGDPIIVPSQDVVLGLYYMTREKINAKGEGMYLTGPAEAEKAYRTKTAELHARVKVRITETIKHEN
GKLTTETKMIDTTVGRAMLWQIVPKGLPYSLVNQKLGKKQISNLLNEAYRKLGLKDTVIFADQIMYTGFAYAALSGVSVG
IDDMVVPAAKYTEIAEAEEEVREIQEQFQSGLVTAGERYNKVIDIWASTNDRVAKAMMENLSSEQVINRQGEQEKQESFN
SIYMMADSGARGSAAQIRQLAGMRGLMARPDGSIIETPITANFKEGLNVLQYFISTHGARKGLADTALKTANSGYLTRRL
VDVAQDVVVTEHDCGTLEGVVMTPHIEGGDVKVALTELALGRVVSEDILKPGTDEVLIPRNTLLDEKWCKVINDNSVDQI
KVRSVVTCDSDFGCCAQCYGRDLARGHLVNQGEAVGVIAAQSIGEPGTQLTMRTFHIGGAASTAAAENSIQAKNNGSVKL
HNAKFVTNKDGKLVITSRASELTIIDEFGRTKEKHKLPYGSMLSKADGDAVAAGETVANWEAHTMPIITEVAGRVQFVDM
IDGVTVSRQTDDLTGLSSSEVTEAAARPAAGKDMRPAIKLVDANGKDVLIPGTDMPAQYFLPGKAIVNLDDGAEVNVGDT
LARIPQKSGGNKDITGGLPRVADLFEARKPKEPAILAEHSGTVSFGKETKGKRRLIITRDSGDTYEEMIPKHRQLNVFEG
ERIERGDVIADGPESPHDILRLRGIHAVTTYIANEVQEVYRLQGVKINDKHIETIVRQMLRKCTITFAGDSEFLPGETVE
YSQVKIANRKLVEEGKEPARFERELLGITKASLATESFISAASFQETTRVLTEAAVSGKRDDLRGLKENVIVGRLIPAGT
GFAYHQDRQAKRAQEQQGPSAEQATDNLAALLNAGFSSDDE

Specific function: DNA-dependent RNA polymerase catalyzes the transcription of DNA into RNA using the four ribonucleoside triphosphates as substrates

COG id: COG0086

COG function: function code K; DNA-directed RNA polymerase, beta' subunit/160 kD subunit

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the RNA polymerase beta' chain family

Homologues:

Organism=Homo sapiens, GI4505939, Length=907, Percent_Identity=26.3506063947078, Blast_Score=209, Evalue=2e-53,
Organism=Homo sapiens, GI39725938, Length=308, Percent_Identity=30.8441558441558, Blast_Score=133, Evalue=2e-30,
Organism=Homo sapiens, GI103471997, Length=593, Percent_Identity=26.3069139966273, Blast_Score=123, Evalue=1e-27,
Organism=Escherichia coli, GI2367335, Length=1405, Percent_Identity=82.4199288256228, Blast_Score=2374, Evalue=0.0,
Organism=Caenorhabditis elegans, GI71987878, Length=653, Percent_Identity=28.1776416539051, Blast_Score=189, Evalue=7e-48,
Organism=Caenorhabditis elegans, GI25145495, Length=673, Percent_Identity=25.55720653789, Blast_Score=186, Evalue=6e-47,
Organism=Saccharomyces cerevisiae, GI6324690, Length=690, Percent_Identity=25.6521739130435, Blast_Score=163, Evalue=2e-40,
Organism=Saccharomyces cerevisiae, GI6320061, Length=308, Percent_Identity=32.7922077922078, Blast_Score=140, Evalue=2e-33,
Organism=Saccharomyces cerevisiae, GI6324917, Length=640, Percent_Identity=24.53125, Blast_Score=124, Evalue=1e-28,
Organism=Drosophila melanogaster, GI17530899, Length=909, Percent_Identity=25.1925192519252, Blast_Score=195, Evalue=2e-49,
Organism=Drosophila melanogaster, GI281360912, Length=513, Percent_Identity=24.9512670565302, Blast_Score=136, Evalue=1e-31,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): RPOC_VIBC3 (A5F3P6)

Other databases:

- EMBL:   CP000627
- EMBL:   CP001235
- ProteinModelPortal:   A5F3P6
- STRING:   A5F3P6
- GenomeReviews:   CP000627_GR
- GenomeReviews:   CP001235_GR
- KEGG:   vco:VC0395_A2731
- eggNOG:   COG0086
- HOGENOM:   HBG621785
- OMA:   FEARVPK
- ProtClustDB:   PRK00566
- BioCyc:   VCHO345073:VC0395_A2731-MONOMER
- HAMAP:   MF_01322
- InterPro:   IPR000722
- InterPro:   IPR006592
- InterPro:   IPR007080
- InterPro:   IPR007066
- InterPro:   IPR007083
- InterPro:   IPR007081
- InterPro:   IPR012754
- SMART:   SM00663
- TIGRFAMs:   TIGR02386

Pfam domain/function: PF04997 RNA_pol_Rpb1_1; PF00623 RNA_pol_Rpb1_2; PF04983 RNA_pol_Rpb1_3; PF05000 RNA_pol_Rpb1_4; PF04998 RNA_pol_Rpb1_5

EC number: =2.7.7.6

Molecular weight: Translated: 155025; Mature: 155025

Theoretical pI: Translated: 6.90; Mature: 6.90

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.0 %Cys     (Translated Protein)
2.9 %Met     (Translated Protein)
3.9 %Cys+Met (Translated Protein)
1.0 %Cys     (Mature Protein)
2.9 %Met     (Mature Protein)
3.9 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKDLLNFLKAQHKTEEFDAIKIGLASPDMIRSWSFGEVKKPETINYRTFKPERDGLFCAR
CHHHHHHHHHHCCCCCCCEEEEECCCCHHHHCCCCCCCCCCCCCCEEECCCCCCCEEEEH
IFGPVKDYECLCGKYKRLKHRGVICEKCGVEVTQTKVRRDRMGHIELASPVAHIWFLKSL
HHCCCCHHHHHHHHHHHHHHCCCCHHHCCCHHHHHHHHHHHCCCEEHHHHHHHHHHHHHH
PSRIGLLMDMPLRDIERVLYFEMYVVTEPGMTDLERGQMLTEEEYLDRLEEWGDEFTAKM
HHHHCHHHCCCHHHHHHHHHHEEEEEECCCCCHHHHCCCCCHHHHHHHHHHHHHHHHHHH
GAEAIKDLLASMDLPAEAEQMREELDTTNSETKRKKLTKRLKLVEAFVASGNKPEWMILT
HHHHHHHHHHHCCCCHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHCCCCCCEEEEE
VLPVLPPDLRPLVPLDGGRFATSDLNDLYRRVINRNNRLKRLLELAAPDIIVRNEKRMLQ
EECCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHCCCHHHHHHHHHHCCCEEEECHHHHHH
ESVDALLDNGRRGRAITGSNKRPLKSLADMIKGKQGRFRQNLLGKRVDYSGRSVITVGPY
HHHHHHHHCCCCCCEECCCCCCHHHHHHHHHCCCCCHHHHHHHCCCCCCCCCEEEEECCC
LRLHQCGLPKKMALELFKPFIYSKLETRGLATTIKAAKKMVEREEAVVWDILDEVIREHP
HHHHHCCCCHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCC
VLLNRAPTLHRLGIQAFEPVLIEGKAIQLHPLVCAAYNADFDGDQMAVHVPLTLEAQLEA
EEECCCCCHHHHCHHHCCCEEECCCEEEEECEEEEEECCCCCCCCEEEEEEEEEECCCCC
RTLMMSTNNILSPASGDPIIVPSQDVVLGLYYMTREKINAKGEGMYLTGPAEAEKAYRTK
EEEEEECCCCCCCCCCCEEEECCCHHHHHHHHHHHHHCCCCCCCEEEECCHHHHHHHHHH
TAELHARVKVRITETIKHENGKLTTETKMIDTTVGRAMLWQIVPKGLPYSLVNQKLGKKQ
HHHEEEEEEEEEEEHEECCCCCEEEHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHH
ISNLLNEAYRKLGLKDTVIFADQIMYTGFAYAALSGVSVGIDDMVVPAAKYTEIAEAEEE
HHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHCCCCCCCCHHHCCCHHHHHHHHHHHH
VREIQEQFQSGLVTAGERYNKVIDIWASTNDRVAKAMMENLSSEQVINRQGEQEKQESFN
HHHHHHHHHCCCCCCCCCCCEEEEEEECCCHHHHHHHHHCCCHHHHHHHCCCHHHHHCCC
SIYMMADSGARGSAAQIRQLAGMRGLMARPDGSIIETPITANFKEGLNVLQYFISTHGAR
EEEEEECCCCCCCHHHHHHHHCCCCCCCCCCCCEEECCCCCCHHHHHHHHHHHHHHCCCC
KGLADTALKTANSGYLTRRLVDVAQDVVVTEHDCGTLEGVVMTPHIEGGDVKVALTELAL
CCHHHHHHHHCCCCHHHHHHHHHHHHHEEEECCCCCCCCEEEECCCCCCCEEEEHHHHHH
GRVVSEDILKPGTDEVLIPRNTLLDEKWCKVINDNSVDQIKVRSVVTCDSDFGCCAQCYG
HHHHHHHHCCCCCCCEEECCHHHCCHHHHHHHCCCCCCEEEEEEEEEECCCCCHHHHHHC
RDLARGHLVNQGEAVGVIAAQSIGEPGTQLTMRTFHIGGAASTAAAENSIQAKNNGSVKL
CHHHCCCCCCCCCEEEEEEHHCCCCCCCEEEEEEEEECCCCHHHHHCCCCEECCCCCEEE
HNAKFVTNKDGKLVITSRASELTIIDEFGRTKEKHKLPYGSMLSKADGDAVAAGETVANW
ECEEEEECCCCCEEEEECCCCEEEEHHHCCCHHHHCCCCHHHHHCCCCCEEECCCHHCCC
EAHTMPIITEVAGRVQFVDMIDGVTVSRQTDDLTGLSSSEVTEAAARPAAGKDMRPAIKL
CCCCCHHHHHHHHHEEEEHHHCCEEEECCCCCCCCCCCHHHHHHHCCCCCCCCCCCEEEE
VDANGKDVLIPGTDMPAQYFLPGKAIVNLDDGAEVNVGDTLARIPQKSGGNKDITGGLPR
EECCCCEEEECCCCCCCEEECCCCEEEECCCCCEECCCHHHHHCCCCCCCCCCCCCCCHH
VADLFEARKPKEPAILAEHSGTVSFGKETKGKRRLIITRDSGDTYEEMIPKHRQLNVFEG
HHHHHHHCCCCCCCEEEECCCCEECCCCCCCCEEEEEECCCCCCHHHHCCCCCCCCCCCC
ERIERGDVIADGPESPHDILRLRGIHAVTTYIANEVQEVYRLQGVKINDKHIETIVRQML
CCCCCCCEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHH
RKCTITFAGDSEFLPGETVEYSQVKIANRKLVEEGKEPARFERELLGITKASLATESFIS
HHCEEEECCCCCCCCCCCCCHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHH
AASFQETTRVLTEAAVSGKRDDLRGLKENVIVGRLIPAGTGFAYHQDRQAKRAQEQQGPS
HHHHHHHHHHHHHHHHCCCHHHHHHHHHCCEEEEEECCCCCCCCCCHHHHHHHHHHCCCC
AEQATDNLAALLNAGFSSDDE
HHHHHHHHHHHHHCCCCCCCC
>Mature Secondary Structure
MKDLLNFLKAQHKTEEFDAIKIGLASPDMIRSWSFGEVKKPETINYRTFKPERDGLFCAR
CHHHHHHHHHHCCCCCCCEEEEECCCCHHHHCCCCCCCCCCCCCCEEECCCCCCCEEEEH
IFGPVKDYECLCGKYKRLKHRGVICEKCGVEVTQTKVRRDRMGHIELASPVAHIWFLKSL
HHCCCCHHHHHHHHHHHHHHCCCCHHHCCCHHHHHHHHHHHCCCEEHHHHHHHHHHHHHH
PSRIGLLMDMPLRDIERVLYFEMYVVTEPGMTDLERGQMLTEEEYLDRLEEWGDEFTAKM
HHHHCHHHCCCHHHHHHHHHHEEEEEECCCCCHHHHCCCCCHHHHHHHHHHHHHHHHHHH
GAEAIKDLLASMDLPAEAEQMREELDTTNSETKRKKLTKRLKLVEAFVASGNKPEWMILT
HHHHHHHHHHHCCCCHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHCCCCCCEEEEE
VLPVLPPDLRPLVPLDGGRFATSDLNDLYRRVINRNNRLKRLLELAAPDIIVRNEKRMLQ
EECCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHCCCHHHHHHHHHHCCCEEEECHHHHHH
ESVDALLDNGRRGRAITGSNKRPLKSLADMIKGKQGRFRQNLLGKRVDYSGRSVITVGPY
HHHHHHHHCCCCCCEECCCCCCHHHHHHHHHCCCCCHHHHHHHCCCCCCCCCEEEEECCC
LRLHQCGLPKKMALELFKPFIYSKLETRGLATTIKAAKKMVEREEAVVWDILDEVIREHP
HHHHHCCCCHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCC
VLLNRAPTLHRLGIQAFEPVLIEGKAIQLHPLVCAAYNADFDGDQMAVHVPLTLEAQLEA
EEECCCCCHHHHCHHHCCCEEECCCEEEEECEEEEEECCCCCCCCEEEEEEEEEECCCCC
RTLMMSTNNILSPASGDPIIVPSQDVVLGLYYMTREKINAKGEGMYLTGPAEAEKAYRTK
EEEEEECCCCCCCCCCCEEEECCCHHHHHHHHHHHHHCCCCCCCEEEECCHHHHHHHHHH
TAELHARVKVRITETIKHENGKLTTETKMIDTTVGRAMLWQIVPKGLPYSLVNQKLGKKQ
HHHEEEEEEEEEEEHEECCCCCEEEHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHH
ISNLLNEAYRKLGLKDTVIFADQIMYTGFAYAALSGVSVGIDDMVVPAAKYTEIAEAEEE
HHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHCCCCCCCCHHHCCCHHHHHHHHHHHH
VREIQEQFQSGLVTAGERYNKVIDIWASTNDRVAKAMMENLSSEQVINRQGEQEKQESFN
HHHHHHHHHCCCCCCCCCCCEEEEEEECCCHHHHHHHHHCCCHHHHHHHCCCHHHHHCCC
SIYMMADSGARGSAAQIRQLAGMRGLMARPDGSIIETPITANFKEGLNVLQYFISTHGAR
EEEEEECCCCCCCHHHHHHHHCCCCCCCCCCCCEEECCCCCCHHHHHHHHHHHHHHCCCC
KGLADTALKTANSGYLTRRLVDVAQDVVVTEHDCGTLEGVVMTPHIEGGDVKVALTELAL
CCHHHHHHHHCCCCHHHHHHHHHHHHHEEEECCCCCCCCEEEECCCCCCCEEEEHHHHHH
GRVVSEDILKPGTDEVLIPRNTLLDEKWCKVINDNSVDQIKVRSVVTCDSDFGCCAQCYG
HHHHHHHHCCCCCCCEEECCHHHCCHHHHHHHCCCCCCEEEEEEEEEECCCCCHHHHHHC
RDLARGHLVNQGEAVGVIAAQSIGEPGTQLTMRTFHIGGAASTAAAENSIQAKNNGSVKL
CHHHCCCCCCCCCEEEEEEHHCCCCCCCEEEEEEEEECCCCHHHHHCCCCEECCCCCEEE
HNAKFVTNKDGKLVITSRASELTIIDEFGRTKEKHKLPYGSMLSKADGDAVAAGETVANW
ECEEEEECCCCCEEEEECCCCEEEEHHHCCCHHHHCCCCHHHHHCCCCCEEECCCHHCCC
EAHTMPIITEVAGRVQFVDMIDGVTVSRQTDDLTGLSSSEVTEAAARPAAGKDMRPAIKL
CCCCCHHHHHHHHHEEEEHHHCCEEEECCCCCCCCCCCHHHHHHHCCCCCCCCCCCEEEE
VDANGKDVLIPGTDMPAQYFLPGKAIVNLDDGAEVNVGDTLARIPQKSGGNKDITGGLPR
EECCCCEEEECCCCCCCEEECCCCEEEECCCCCEECCCHHHHHCCCCCCCCCCCCCCCHH
VADLFEARKPKEPAILAEHSGTVSFGKETKGKRRLIITRDSGDTYEEMIPKHRQLNVFEG
HHHHHHHCCCCCCCEEEECCCCEECCCCCCCCEEEEEECCCCCCHHHHCCCCCCCCCCCC
ERIERGDVIADGPESPHDILRLRGIHAVTTYIANEVQEVYRLQGVKINDKHIETIVRQML
CCCCCCCEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHH
RKCTITFAGDSEFLPGETVEYSQVKIANRKLVEEGKEPARFERELLGITKASLATESFIS
HHCEEEECCCCCCCCCCCCCHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHH
AASFQETTRVLTEAAVSGKRDDLRGLKENVIVGRLIPAGTGFAYHQDRQAKRAQEQQGPS
HHHHHHHHHHHHHHHHCCCHHHHHHHHHCCEEEEEECCCCCCCCCCHHHHHHHHHHCCCC
AEQATDNLAALLNAGFSSDDE
HHHHHHHHHHHHHCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA