| Definition | Mycobacterium sp. MCS chromosome, complete genome. |
|---|---|
| Accession | NC_008146 |
| Length | 5,705,448 |
Click here to switch to the map view.
The map label for this gene is groEL [H]
Identifier: 108798126
GI number: 108798126
Start: 1251505
End: 1253127
Strand: Direct
Name: groEL [H]
Synonym: Mmcs_1154
Alternate gene names: 108798126
Gene position: 1251505-1253127 (Clockwise)
Preceding gene: 108798125
Following gene: 108798128
Centisome position: 21.94
GC content: 69.5
Gene sequence:
>1623_bases ATGAGCAAGCAGATCGAATTCAACGAAACTGCGCGCCGCGCAATGGAGATCGGCGTAGACAAGCTCGCCGACGCGGTGAA GGTGACCCTGGGGCCGCGCGGTCGCAACGTGGTGCTCGCCAAGTCGTGGGGCGGCCCGACCGTCACCAACGACGGTGTCA CCATCGCCCGTGAGATCGACCTCGAGGATCCGTTCGAGAACCTCGGCGCCCAGCTGGTCAAGTCGGTGGCGACCAAGACC AACGACGTCGCCGGCGACGGCACCACCACCGCCACCGTGCTGGCGCAGGCGCTGGTGCGCGCCGGTCTGCGCAACGTCGC GGCCGGCGCCAACCCGATCGCCCTGGGCGCGGGGATCAGCAAGGCCGCCGACGCCGTGTCCGAGGCGCTGCTGGCCGCGG CCACCCCCGTCGACGACAAGAGCGGTATCGCCCAGGTCGCCACGGTCAGCTCACGCGACGAGCAGATCGGCGAGCTGGTC GGCGAGGCGATGACCAAGGTCGGCCACGACGGTGTCGTGACCGTCGAGGAGTCCTCGACCCTGAACACCGAACTCGAGGT CACCGAGGGCGTCGGCTTCGACAAGGGGTTCATCTCGGCGTACTTCGTCACCGACTTCGACTCCCAGGAAGCGGTGCTCG AGGACGCGCTGGTGCTGCTGCACCGCGAGAAGGTCAGCTCGCTGCCGGACCTGCTGCCGCTGCTGGAGAAGGTCGCCGAA GCCGGTAAGCCGCTGCTGATCATCGCCGAGGACGTCGAGGGTGAGGCGCTGTCCACACTGGTGGTCAACGCGATCCGTAA GACGCTCAAGGCCGTCGCCGTCAAGGCGCCGTTCTTCGGTGACCGTCGCAAGGCGTTCCTCGACGACCTCGCCGTCGTCA CCGGCGGCCAGGTGATCAACCCCGACGTCGGCCTGGTGCTGCGCGAGGTCGGCCTCGACGTCCTGGGCACCGCGCGCCGC GTGGTGGTCACCAAGGACAGCACCGTGATCGTCGACGGCGGCGGCAGCGCCGACGCCATCGCCGACCGGGCCAAGCAGCT GCGGGCCGAGATCGAGGCGACCGACTCCGACTGGGATCGCGAGAAGCTCGAGGAGCGGCTGGCCAAGCTGGCCGGCGGCG TCGCGGTGATCAAGGTCGGTGCGGCCACCGAGACCGATCTGAAGAAGCGCAAGGAAGCCGTCGAGGACGCGGTCTCCGCG GCCAAGGCGGCCGTCGAGGAGGGCATCGTCACCGGCGGCGGTGCCGCCCTGGTGCAGGCCCGCAAGGCGCTGGACAGCCT GCGGGGCTCGGTCTCCGGCGACGAGGCGCTCGGTGTCGAGGTGTTCAACTCCGCGCTGTCGGCTCCGCTGTACTGGATCG CCACCAACGCCGGGCTCGACGGTTCGGTCGTGGTGAACAAGGTCAGCGAACTGCCTGCGGGACAGGGCTTCAACGCCGCG ACGCTCGAGTTCGGCGACCTGCTCGCCGACGGCGTCGTCGACCCGGTCAAGGTGACGCGATCGGCGGTGCTCAACGCCGC GTCGGTCGCCCGCATGGTGCTCACCACCGAGACCGCGATCGTCGACAAGCCGGCCGAGGAAGAGGATCACGGCCACGGCC ACCATCACGGCCACGCTCACTGA
Upstream 100 bases:
>100_bases CGTCAACAAGTAAGCACCCGTGTCCGCCCCGGAGATCCCCGTATTGCACGGGTGATGTCCGGGGCGGCATGCGTTGCATG CCAAAAACAGGAAGACACAT
Downstream 100 bases:
>100_bases GTAGTCCGCACGACGCACCCCCGGTCCTGTTGGGCCGGGGGTGCGTTCGTTGGGCGTAGAAGTCTTCAGATCCGCCGACC CCGGCAGCGCTCAGGGAGCC
Product: chaperonin GroEL
Products: NA
Alternate protein names: GroEL protein 2; Protein Cpn60 2 [H]
Number of amino acids: Translated: 540; Mature: 539
Protein sequence:
>540_residues MSKQIEFNETARRAMEIGVDKLADAVKVTLGPRGRNVVLAKSWGGPTVTNDGVTIAREIDLEDPFENLGAQLVKSVATKT NDVAGDGTTTATVLAQALVRAGLRNVAAGANPIALGAGISKAADAVSEALLAAATPVDDKSGIAQVATVSSRDEQIGELV GEAMTKVGHDGVVTVEESSTLNTELEVTEGVGFDKGFISAYFVTDFDSQEAVLEDALVLLHREKVSSLPDLLPLLEKVAE AGKPLLIIAEDVEGEALSTLVVNAIRKTLKAVAVKAPFFGDRRKAFLDDLAVVTGGQVINPDVGLVLREVGLDVLGTARR VVVTKDSTVIVDGGGSADAIADRAKQLRAEIEATDSDWDREKLEERLAKLAGGVAVIKVGAATETDLKKRKEAVEDAVSA AKAAVEEGIVTGGGAALVQARKALDSLRGSVSGDEALGVEVFNSALSAPLYWIATNAGLDGSVVVNKVSELPAGQGFNAA TLEFGDLLADGVVDPVKVTRSAVLNAASVARMVLTTETAIVDKPAEEEDHGHGHHHGHAH
Sequences:
>Translated_540_residues MSKQIEFNETARRAMEIGVDKLADAVKVTLGPRGRNVVLAKSWGGPTVTNDGVTIAREIDLEDPFENLGAQLVKSVATKT NDVAGDGTTTATVLAQALVRAGLRNVAAGANPIALGAGISKAADAVSEALLAAATPVDDKSGIAQVATVSSRDEQIGELV GEAMTKVGHDGVVTVEESSTLNTELEVTEGVGFDKGFISAYFVTDFDSQEAVLEDALVLLHREKVSSLPDLLPLLEKVAE AGKPLLIIAEDVEGEALSTLVVNAIRKTLKAVAVKAPFFGDRRKAFLDDLAVVTGGQVINPDVGLVLREVGLDVLGTARR VVVTKDSTVIVDGGGSADAIADRAKQLRAEIEATDSDWDREKLEERLAKLAGGVAVIKVGAATETDLKKRKEAVEDAVSA AKAAVEEGIVTGGGAALVQARKALDSLRGSVSGDEALGVEVFNSALSAPLYWIATNAGLDGSVVVNKVSELPAGQGFNAA TLEFGDLLADGVVDPVKVTRSAVLNAASVARMVLTTETAIVDKPAEEEDHGHGHHHGHAH >Mature_539_residues SKQIEFNETARRAMEIGVDKLADAVKVTLGPRGRNVVLAKSWGGPTVTNDGVTIAREIDLEDPFENLGAQLVKSVATKTN DVAGDGTTTATVLAQALVRAGLRNVAAGANPIALGAGISKAADAVSEALLAAATPVDDKSGIAQVATVSSRDEQIGELVG EAMTKVGHDGVVTVEESSTLNTELEVTEGVGFDKGFISAYFVTDFDSQEAVLEDALVLLHREKVSSLPDLLPLLEKVAEA GKPLLIIAEDVEGEALSTLVVNAIRKTLKAVAVKAPFFGDRRKAFLDDLAVVTGGQVINPDVGLVLREVGLDVLGTARRV VVTKDSTVIVDGGGSADAIADRAKQLRAEIEATDSDWDREKLEERLAKLAGGVAVIKVGAATETDLKKRKEAVEDAVSAA KAAVEEGIVTGGGAALVQARKALDSLRGSVSGDEALGVEVFNSALSAPLYWIATNAGLDGSVVVNKVSELPAGQGFNAAT LEFGDLLADGVVDPVKVTRSAVLNAASVARMVLTTETAIVDKPAEEEDHGHGHHHGHAH
Specific function: Prevents misfolding and promotes the refolding and proper assembly of unfolded polypeptides generated under stress conditions [H]
COG id: COG0459
COG function: function code O; Chaperonin GroEL (HSP60 family)
Gene ontology:
Cell location: Cytoplasm [H]
Metaboloic importance: Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the chaperonin (HSP60) family [H]
Homologues:
Organism=Homo sapiens, GI41399285, Length=530, Percent_Identity=45.6603773584906, Blast_Score=456, Evalue=1e-128, Organism=Homo sapiens, GI31542947, Length=530, Percent_Identity=45.6603773584906, Blast_Score=456, Evalue=1e-128, Organism=Homo sapiens, GI38455427, Length=569, Percent_Identity=21.0896309314587, Blast_Score=72, Evalue=1e-12, Organism=Homo sapiens, GI5453603, Length=131, Percent_Identity=38.1679389312977, Blast_Score=70, Evalue=6e-12, Organism=Escherichia coli, GI1790586, Length=524, Percent_Identity=54.9618320610687, Blast_Score=545, Evalue=1e-156, Organism=Caenorhabditis elegans, GI17555558, Length=530, Percent_Identity=43.0188679245283, Blast_Score=432, Evalue=1e-121, Organism=Caenorhabditis elegans, GI193210679, Length=211, Percent_Identity=39.3364928909953, Blast_Score=157, Evalue=2e-38, Organism=Caenorhabditis elegans, GI17564182, Length=528, Percent_Identity=22.5378787878788, Blast_Score=70, Evalue=2e-12, Organism=Saccharomyces cerevisiae, GI6323288, Length=525, Percent_Identity=45.9047619047619, Blast_Score=452, Evalue=1e-128, Organism=Saccharomyces cerevisiae, GI6322524, Length=113, Percent_Identity=36.283185840708, Blast_Score=69, Evalue=2e-12, Organism=Saccharomyces cerevisiae, GI6320393, Length=548, Percent_Identity=22.0802919708029, Blast_Score=67, Evalue=9e-12, Organism=Drosophila melanogaster, GI24641193, Length=528, Percent_Identity=46.4015151515151, Blast_Score=469, Evalue=1e-132, Organism=Drosophila melanogaster, GI24641191, Length=528, Percent_Identity=46.4015151515151, Blast_Score=469, Evalue=1e-132, Organism=Drosophila melanogaster, GI45550936, Length=528, Percent_Identity=44.3181818181818, Blast_Score=447, Evalue=1e-126, Organism=Drosophila melanogaster, GI45550132, Length=528, Percent_Identity=44.3181818181818, Blast_Score=447, Evalue=1e-126, Organism=Drosophila melanogaster, GI45550935, Length=528, Percent_Identity=44.3181818181818, Blast_Score=447, Evalue=1e-126, Organism=Drosophila melanogaster, GI17864606, Length=524, Percent_Identity=39.8854961832061, Blast_Score=375, Evalue=1e-104, Organism=Drosophila melanogaster, GI24584129, Length=529, Percent_Identity=33.4593572778828, Blast_Score=270, Evalue=2e-72, Organism=Drosophila melanogaster, GI19921262, Length=529, Percent_Identity=33.4593572778828, Blast_Score=270, Evalue=2e-72, Organism=Drosophila melanogaster, GI24645179, Length=479, Percent_Identity=21.294363256785, Blast_Score=73, Evalue=6e-13, Organism=Drosophila melanogaster, GI24583944, Length=132, Percent_Identity=30.3030303030303, Blast_Score=67, Evalue=4e-11, Organism=Drosophila melanogaster, GI18858175, Length=134, Percent_Identity=35.8208955223881, Blast_Score=66, Evalue=5e-11, Organism=Drosophila melanogaster, GI28571140, Length=134, Percent_Identity=35.8208955223881, Blast_Score=66, Evalue=5e-11,
Paralogues:
None
Copy number: 2180 Molecules/Cell In: Growth Phase, Minimal Media (Based on E. coli). 360 Molecules/Cell In: Growth Phase, Minimal Media (Based on E. coli). 480 Molecules/Cell In: Stationary Phase, Rich Media (Based on E. coli). 15012 Molecules/Cell In: Growth Phase,
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR018370 - InterPro: IPR001844 - InterPro: IPR002423 [H]
Pfam domain/function: PF00118 Cpn60_TCP1 [H]
EC number: NA
Molecular weight: Translated: 56004; Mature: 55873
Theoretical pI: Translated: 4.53; Mature: 4.53
Prosite motif: PS00296 CHAPERONINS_CPN60
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.0 %Cys (Translated Protein) 0.7 %Met (Translated Protein) 0.7 %Cys+Met (Translated Protein) 0.0 %Cys (Mature Protein) 0.6 %Met (Mature Protein) 0.6 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MSKQIEFNETARRAMEIGVDKLADAVKVTLGPRGRNVVLAKSWGGPTVTNDGVTIAREID CCCCCCCHHHHHHHHHHHHHHHHHHHEEEECCCCCEEEEEECCCCCCCCCCCEEEEEECC LEDPFENLGAQLVKSVATKTNDVAGDGTTTATVLAQALVRAGLRNVAAGANPIALGAGIS CCCHHHHHHHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHHHCCCCCEEECCCHH KAADAVSEALLAAATPVDDKSGIAQVATVSSRDEQIGELVGEAMTKVGHDGVVTVEESST HHHHHHHHHHHHHCCCCCCCCCCHHHHCCCCHHHHHHHHHHHHHHHCCCCCEEEEECCCC LNTELEVTEGVGFDKGFISAYFVTDFDSQEAVLEDALVLLHREKVSSLPDLLPLLEKVAE CCCEEEEECCCCCCCCCEEEEEEECCCCHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHH AGKPLLIIAEDVEGEALSTLVVNAIRKTLKAVAVKAPFFGDRRKAFLDDLAVVTGGQVIN CCCCEEEEEECCCCHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHCCCEEEC PDVGLVLREVGLDVLGTARRVVVTKDSTVIVDGGGSADAIADRAKQLRAEIEATDSDWDR CCHHHHHHHHCHHHHCCCCEEEEECCCEEEEECCCCHHHHHHHHHHHHHHHHCCCCCCCH EKLEERLAKLAGGVAVIKVGAATETDLKKRKEAVEDAVSAAKAAVEEGIVTGGGAALVQA HHHHHHHHHHHCCEEEEEECCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHH RKALDSLRGSVSGDEALGVEVFNSALSAPLYWIATNAGLDGSVVVNKVSELPAGQGFNAA HHHHHHHCCCCCCCCHHHHHHHHHHHCCCEEEEEECCCCCCHHHHHHHHHCCCCCCCCCH TLEFGDLLADGVVDPVKVTRSAVLNAASVARMVLTTETAIVDKPAEEEDHGHGHHHGHAH HHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCC >Mature Secondary Structure SKQIEFNETARRAMEIGVDKLADAVKVTLGPRGRNVVLAKSWGGPTVTNDGVTIAREID CCCCCCHHHHHHHHHHHHHHHHHHHEEEECCCCCEEEEEECCCCCCCCCCCEEEEEECC LEDPFENLGAQLVKSVATKTNDVAGDGTTTATVLAQALVRAGLRNVAAGANPIALGAGIS CCCHHHHHHHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHHHCCCCCEEECCCHH KAADAVSEALLAAATPVDDKSGIAQVATVSSRDEQIGELVGEAMTKVGHDGVVTVEESST HHHHHHHHHHHHHCCCCCCCCCCHHHHCCCCHHHHHHHHHHHHHHHCCCCCEEEEECCCC LNTELEVTEGVGFDKGFISAYFVTDFDSQEAVLEDALVLLHREKVSSLPDLLPLLEKVAE CCCEEEEECCCCCCCCCEEEEEEECCCCHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHH AGKPLLIIAEDVEGEALSTLVVNAIRKTLKAVAVKAPFFGDRRKAFLDDLAVVTGGQVIN CCCCEEEEEECCCCHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHCCCEEEC PDVGLVLREVGLDVLGTARRVVVTKDSTVIVDGGGSADAIADRAKQLRAEIEATDSDWDR CCHHHHHHHHCHHHHCCCCEEEEECCCEEEEECCCCHHHHHHHHHHHHHHHHCCCCCCCH EKLEERLAKLAGGVAVIKVGAATETDLKKRKEAVEDAVSAAKAAVEEGIVTGGGAALVQA HHHHHHHHHHHCCEEEEEECCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHH RKALDSLRGSVSGDEALGVEVFNSALSAPLYWIATNAGLDGSVVVNKVSELPAGQGFNAA HHHHHHHCCCCCCCCHHHHHHHHHHHCCCEEEEEECCCCCCHHHHHHHHHCCCCCCCCCH TLEFGDLLADGVVDPVKVTRSAVLNAASVARMVLTTETAIVDKPAEEEDHGHGHHHGHAH HHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: NA