Definition Trichodesmium erythraeum IMS101 chromosome, complete genome.
Accession NC_008312
Length 7,750,108

Click here to switch to the map view.

The map label for this gene is clpB1 [H]

Identifier: 113476693

GI number: 113476693

Start: 4808487

End: 4810391

Strand: Reverse

Name: clpB1 [H]

Synonym: Tery_3151

Alternate gene names: 113476693

Gene position: 4810391-4808487 (Counterclockwise)

Preceding gene: 113476694

Following gene: 113476692

Centisome position: 62.07

GC content: 42.68

Gene sequence:

>1905_bases
ATGAAAAAAGTGGTTGACGATAGTTTCAAAATACGATGGATTCAGGAATTTGAAAAGCTGATTCACCGTCGCCAACATAT
TATTTTATACGGAAACATTTACGACCATTTTTTGTGGCGCGGCGCTTATCAGAGTATCCACCATTTCCTAAAATCTTATT
TCTTAGATAACCAGTTCGATCTGGTTGTTAGTTACGACGATATAGAAAAGTTCAAGTTTGCTAAACCTGATATGACGGAA
CTTTTTGATAACTTGGCATTGCGTCGTGGTGCTTTGGAAACTTATCTACCTATAGAAGAATCGTTTCGGCAAATATTTGG
GTTATTATCCCAACCAAAAACATCCGTGGCGGTGACGGTGGAACTGGGGGATATGTTGGCGTCGAAGAGTATTAGTCAAG
GCAGCGGGCGACATCCTCTCATGATGTTGAAAAAATCTACTTTAGAAGCATCTTTAATCGCCAATGGTGCTTTAAAAGGA
TTTCGCAATACTCTGGTAATTTTAGTTAACGAACTTGAAACTGTACCCCAATGGTTTTACCATAAAAACCCTTTTTTGCG
GAGAATACAAGTTTCGCTTCCCAGTAAGGACGAACGCCGCGAGTTTGCATTGCGCTTTTTTGCTCCTATGGCTAACGGGA
TGGGGGGATTTTATGAGGGCGATCGTATCGAAGTCCATCCCCCTTCTCCAGAACAGCCCTCGGAACTAGAAGTCTTGGCA
GAGGAGTTTGCGGACCTGACGGAGGAATTTCAAATCTGGGATCTGGAGGCTTTGCGTCATACTTCCTGGCAGGAAAAAAT
TCCCCTGGAAACTAATAAAATATGGCGGTTGGTTAACTTTTATAAGTTTGGCCAACGGGAAGACCCCTGGGAAAAGTTGA
GCGCGGATAAAGTCGCAAATGCCGGGAAAGAACTGTCTGAGATGGTCTTGGGACAAGAGAGGGCGATTTCTGCTGTCACT
ACGATGTTGAGTTCCGCTAGGGTGGGGTTGAGCATGAGCAGCAACAAGGGTCCCAGCGGTAAACCGAAAGGGGTTTTCTT
TTTTGTGGGGCCGACGGGTGTGGGCAAAACCGAACTGGCAAAGGCGATGACTAAGCTGGTTTTTGGTAATGAGGAGGCTT
TTGCCCGCTTTGATATGAGTGAGTATAGGGAAGAAAACGCGGACCAAAAGCTAATTGGTGCCCCTCCTGGCTATACGGGT
TATGAGGAAGGGGGACAGCTAACTAATCGAGTTATTGACTACCCTTACAGCATTTTACTGTTTGATGAAATTGAGAAAGC
ACATCCTAAAATTTTAGATAAATTTCTGCAAATTTTGGAGGATGGCAGACTGACCGATGGTAAGGGACAAACTGCTTATT
TTAGCCAAACGGCGATTATTTTTACTAGCAATATTGGAGCATCTGACAAAACTGACCCCCAAACTGGTAATATTATCCGA
GAGGGAATTATGAATCGCGTTAAAGATGGGGATGTTTTTGGTTATGAAGAGGTAAAAACTCATTTTGAGGCTGAGGTGTA
TTGGTATTTTACGAGTCTCATTGGTCGGGCCGAGTTGCTGAGTCGTTTGGGGGACAATATTGTGGTGTTTGATTTGTTGC
GATCGCAATTTGTCAGTATGATTGGAAAAAAGTTATTACTAAAATTGGCAGAAGTAGCAGCAGAAAAGTATCAGTTAATA
CTCAAATTTCAGCCTTCAGTTTATGGTGTTTTGAGGAAAAGGATGGGAGAAGGAGATAATTTGCTGTTTGGAGGACGACG
AATTAAAACTGTATTGGAAAGTTTGGTTGAACGTCCGCTTAATAGTTGGATTTTTAAGAATTTTTCTGACACCAGCGAAT
TAGCAGGACATACGCTGAAAGTGGGGATAAAAAGCAATGGAGAGTTAGAGGTAGATCGAGTTTGA

Upstream 100 bases:

>100_bases
TCGCCGGAGTTGCTGAATATAATTGCTTTTTGTTATCTAAAACAGCACTCCTGCTTCTCACAAAATACAAGGCTAATTTA
TCAAAAAAGCATGAGATTTG

Downstream 100 bases:

>100_bases
GGGATTAATTAATAGAGTTCAACTAATTAGTAAAAGAATCTACTATGAACAATACTTTACTTTGGAAAATGCTAGAAGGG
CAAGTTATTGAAAAAAAATA

Product: ATPase

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 634; Mature: 634

Protein sequence:

>634_residues
MKKVVDDSFKIRWIQEFEKLIHRRQHIILYGNIYDHFLWRGAYQSIHHFLKSYFLDNQFDLVVSYDDIEKFKFAKPDMTE
LFDNLALRRGALETYLPIEESFRQIFGLLSQPKTSVAVTVELGDMLASKSISQGSGRHPLMMLKKSTLEASLIANGALKG
FRNTLVILVNELETVPQWFYHKNPFLRRIQVSLPSKDERREFALRFFAPMANGMGGFYEGDRIEVHPPSPEQPSELEVLA
EEFADLTEEFQIWDLEALRHTSWQEKIPLETNKIWRLVNFYKFGQREDPWEKLSADKVANAGKELSEMVLGQERAISAVT
TMLSSARVGLSMSSNKGPSGKPKGVFFFVGPTGVGKTELAKAMTKLVFGNEEAFARFDMSEYREENADQKLIGAPPGYTG
YEEGGQLTNRVIDYPYSILLFDEIEKAHPKILDKFLQILEDGRLTDGKGQTAYFSQTAIIFTSNIGASDKTDPQTGNIIR
EGIMNRVKDGDVFGYEEVKTHFEAEVYWYFTSLIGRAELLSRLGDNIVVFDLLRSQFVSMIGKKLLLKLAEVAAEKYQLI
LKFQPSVYGVLRKRMGEGDNLLFGGRRIKTVLESLVERPLNSWIFKNFSDTSELAGHTLKVGIKSNGELEVDRV

Sequences:

>Translated_634_residues
MKKVVDDSFKIRWIQEFEKLIHRRQHIILYGNIYDHFLWRGAYQSIHHFLKSYFLDNQFDLVVSYDDIEKFKFAKPDMTE
LFDNLALRRGALETYLPIEESFRQIFGLLSQPKTSVAVTVELGDMLASKSISQGSGRHPLMMLKKSTLEASLIANGALKG
FRNTLVILVNELETVPQWFYHKNPFLRRIQVSLPSKDERREFALRFFAPMANGMGGFYEGDRIEVHPPSPEQPSELEVLA
EEFADLTEEFQIWDLEALRHTSWQEKIPLETNKIWRLVNFYKFGQREDPWEKLSADKVANAGKELSEMVLGQERAISAVT
TMLSSARVGLSMSSNKGPSGKPKGVFFFVGPTGVGKTELAKAMTKLVFGNEEAFARFDMSEYREENADQKLIGAPPGYTG
YEEGGQLTNRVIDYPYSILLFDEIEKAHPKILDKFLQILEDGRLTDGKGQTAYFSQTAIIFTSNIGASDKTDPQTGNIIR
EGIMNRVKDGDVFGYEEVKTHFEAEVYWYFTSLIGRAELLSRLGDNIVVFDLLRSQFVSMIGKKLLLKLAEVAAEKYQLI
LKFQPSVYGVLRKRMGEGDNLLFGGRRIKTVLESLVERPLNSWIFKNFSDTSELAGHTLKVGIKSNGELEVDRV
>Mature_634_residues
MKKVVDDSFKIRWIQEFEKLIHRRQHIILYGNIYDHFLWRGAYQSIHHFLKSYFLDNQFDLVVSYDDIEKFKFAKPDMTE
LFDNLALRRGALETYLPIEESFRQIFGLLSQPKTSVAVTVELGDMLASKSISQGSGRHPLMMLKKSTLEASLIANGALKG
FRNTLVILVNELETVPQWFYHKNPFLRRIQVSLPSKDERREFALRFFAPMANGMGGFYEGDRIEVHPPSPEQPSELEVLA
EEFADLTEEFQIWDLEALRHTSWQEKIPLETNKIWRLVNFYKFGQREDPWEKLSADKVANAGKELSEMVLGQERAISAVT
TMLSSARVGLSMSSNKGPSGKPKGVFFFVGPTGVGKTELAKAMTKLVFGNEEAFARFDMSEYREENADQKLIGAPPGYTG
YEEGGQLTNRVIDYPYSILLFDEIEKAHPKILDKFLQILEDGRLTDGKGQTAYFSQTAIIFTSNIGASDKTDPQTGNIIR
EGIMNRVKDGDVFGYEEVKTHFEAEVYWYFTSLIGRAELLSRLGDNIVVFDLLRSQFVSMIGKKLLLKLAEVAAEKYQLI
LKFQPSVYGVLRKRMGEGDNLLFGGRRIKTVLESLVERPLNSWIFKNFSDTSELAGHTLKVGIKSNGELEVDRV

Specific function: Part of a stress-induced multi-chaperone system, it is involved in the recovery of the cell from heat-induced damage, in cooperation with DnaK, DnaJ and GrpE. Acts before DnaK, in the processing of protein aggregates. Protein binding stimulates the ATPase

COG id: COG0542

COG function: function code O; ATPases with chaperone activity, ATP-binding subunit

Gene ontology:

Cell location: Cytoplasm (Probable) [H]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the clpA/clpB family [H]

Homologues:

Organism=Homo sapiens, GI13540606, Length=303, Percent_Identity=33.6633663366337, Blast_Score=150, Evalue=3e-36,
Organism=Escherichia coli, GI1788943, Length=311, Percent_Identity=36.3344051446945, Blast_Score=187, Evalue=3e-48,
Organism=Escherichia coli, GI1787109, Length=320, Percent_Identity=34.0625, Blast_Score=169, Evalue=7e-43,
Organism=Saccharomyces cerevisiae, GI6320464, Length=162, Percent_Identity=46.9135802469136, Blast_Score=155, Evalue=1e-38,
Organism=Saccharomyces cerevisiae, GI6323002, Length=256, Percent_Identity=38.671875, Blast_Score=154, Evalue=3e-38,

Paralogues:

None

Copy number: 560 Molecules/Cell In: Glucose minimal media [C]

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR003593
- InterPro:   IPR013093
- InterPro:   IPR003959
- InterPro:   IPR018368
- InterPro:   IPR017730
- InterPro:   IPR001270
- InterPro:   IPR019489
- InterPro:   IPR004176
- InterPro:   IPR023150 [H]

Pfam domain/function: PF00004 AAA; PF07724 AAA_2; PF02861 Clp_N; PF10431 ClpB_D2-small [H]

EC number: NA

Molecular weight: Translated: 72259; Mature: 72259

Theoretical pI: Translated: 6.41; Mature: 6.41

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.0 %Cys     (Translated Protein)
2.4 %Met     (Translated Protein)
2.4 %Cys+Met (Translated Protein)
0.0 %Cys     (Mature Protein)
2.4 %Met     (Mature Protein)
2.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKKVVDDSFKIRWIQEFEKLIHRRQHIILYGNIYDHFLWRGAYQSIHHFLKSYFLDNQFD
CCCCCCCCHHHHHHHHHHHHHHCCCEEEEECCHHHHHHHHHHHHHHHHHHHHHHCCCCEE
LVVSYDDIEKFKFAKPDMTELFDNLALRRGALETYLPIEESFRQIFGLLSQPKTSVAVTV
EEEEECCHHHHCCCCCCHHHHHHHHHHHHCCHHHCCCHHHHHHHHHHHHCCCCCCEEEEE
ELGDMLASKSISQGSGRHPLMMLKKSTLEASLIANGALKGFRNTLVILVNELETVPQWFY
EHHHHHHHCCCCCCCCCCCEEEEHHHHHHHHHHHHHHHHHHHHHHEEEEHHHHHHHHHHH
HKNPFLRRIQVSLPSKDERREFALRFFAPMANGMGGFYEGDRIEVHPPSPEQPSELEVLA
CCCCHHEEEEEECCCCHHHHHHHHHHHHHHHCCCCCCCCCCEEEECCCCCCCCHHHHHHH
EEFADLTEEFQIWDLEALRHTSWQEKIPLETNKIWRLVNFYKFGQREDPWEKLSADKVAN
HHHHHHHHHHHHEEHHHHHCCCCHHCCCCCHHHHHHHHHHHHCCCCCCHHHHHHHHHHHH
AGKELSEMVLGQERAISAVTTMLSSARVGLSMSSNKGPSGKPKGVFFFVGPTGVGKTELA
HHHHHHHHHHCHHHHHHHHHHHHHHHHCCEEECCCCCCCCCCCEEEEEECCCCCCHHHHH
KAMTKLVFGNEEAFARFDMSEYREENADQKLIGAPPGYTGYEEGGQLTNRVIDYPYSILL
HHHHHHHCCCCHHHHHCCHHHHHHCCCCCEEECCCCCCCCCCCCHHHHHHHHHCCCEEEE
FDEIEKAHPKILDKFLQILEDGRLTDGKGQTAYFSQTAIIFTSNIGASDKTDPQTGNIIR
EHHHHHCCHHHHHHHHHHHHCCCCCCCCCCEEEEECEEEEEEECCCCCCCCCCCCHHHHH
EGIMNRVKDGDVFGYEEVKTHFEAEVYWYFTSLIGRAELLSRLGDNIVVFDLLRSQFVSM
HHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEHHHHHHHHHHHH
IGKKLLLKLAEVAAEKYQLILKFQPSVYGVLRKRMGEGDNLLFGGRRIKTVLESLVERPL
HHHHHHHHHHHHHHHHHEEEEEECCHHHHHHHHHCCCCCCEEECCHHHHHHHHHHHHHHH
NSWIFKNFSDTSELAGHTLKVGIKSNGELEVDRV
HHHHHCCCCCHHHHCCCEEEEEECCCCCEEECCC
>Mature Secondary Structure
MKKVVDDSFKIRWIQEFEKLIHRRQHIILYGNIYDHFLWRGAYQSIHHFLKSYFLDNQFD
CCCCCCCCHHHHHHHHHHHHHHCCCEEEEECCHHHHHHHHHHHHHHHHHHHHHHCCCCEE
LVVSYDDIEKFKFAKPDMTELFDNLALRRGALETYLPIEESFRQIFGLLSQPKTSVAVTV
EEEEECCHHHHCCCCCCHHHHHHHHHHHHCCHHHCCCHHHHHHHHHHHHCCCCCCEEEEE
ELGDMLASKSISQGSGRHPLMMLKKSTLEASLIANGALKGFRNTLVILVNELETVPQWFY
EHHHHHHHCCCCCCCCCCCEEEEHHHHHHHHHHHHHHHHHHHHHHEEEEHHHHHHHHHHH
HKNPFLRRIQVSLPSKDERREFALRFFAPMANGMGGFYEGDRIEVHPPSPEQPSELEVLA
CCCCHHEEEEEECCCCHHHHHHHHHHHHHHHCCCCCCCCCCEEEECCCCCCCCHHHHHHH
EEFADLTEEFQIWDLEALRHTSWQEKIPLETNKIWRLVNFYKFGQREDPWEKLSADKVAN
HHHHHHHHHHHHEEHHHHHCCCCHHCCCCCHHHHHHHHHHHHCCCCCCHHHHHHHHHHHH
AGKELSEMVLGQERAISAVTTMLSSARVGLSMSSNKGPSGKPKGVFFFVGPTGVGKTELA
HHHHHHHHHHCHHHHHHHHHHHHHHHHCCEEECCCCCCCCCCCEEEEEECCCCCCHHHHH
KAMTKLVFGNEEAFARFDMSEYREENADQKLIGAPPGYTGYEEGGQLTNRVIDYPYSILL
HHHHHHHCCCCHHHHHCCHHHHHHCCCCCEEECCCCCCCCCCCCHHHHHHHHHCCCEEEE
FDEIEKAHPKILDKFLQILEDGRLTDGKGQTAYFSQTAIIFTSNIGASDKTDPQTGNIIR
EHHHHHCCHHHHHHHHHHHHCCCCCCCCCCEEEEECEEEEEEECCCCCCCCCCCCHHHHH
EGIMNRVKDGDVFGYEEVKTHFEAEVYWYFTSLIGRAELLSRLGDNIVVFDLLRSQFVSM
HHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEHHHHHHHHHHHH
IGKKLLLKLAEVAAEKYQLILKFQPSVYGVLRKRMGEGDNLLFGGRRIKTVLESLVERPL
HHHHHHHHHHHHHHHHHEEEEEECCHHHHHHHHHCCCCCCEEECCHHHHHHHHHHHHHHH
NSWIFKNFSDTSELAGHTLKVGIKSNGELEVDRV
HHHHHCCCCCHHHHCCCEEEEEECCCCCEEECCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: Hydrolase; Acting on peptide bonds (Peptidases); Serine endopeptidases [C]

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 11759840 [H]