Definition Trichodesmium erythraeum IMS101 chromosome, complete genome.
Accession NC_008312
Length 7,750,108

Click here to switch to the map view.

The map label for this gene is dnaK [H]

Identifier: 113477655

GI number: 113477655

Start: 6549951

End: 6551546

Strand: Reverse

Name: dnaK [H]

Synonym: Tery_4243

Alternate gene names: 113477655

Gene position: 6551546-6549951 (Counterclockwise)

Preceding gene: 113477657

Following gene: 113477654

Centisome position: 84.53

GC content: 32.64

Gene sequence:

>1596_bases
ATGAAAATTGGCTTAGATTTCGGAACTACTAATTCAATTATTTCTTTTATTACTAACGATAAACCTGAAGCTTATTCCTA
TCCACCATTAAATGGAGAAAAGTATATTCCTTCTTTCATTGCCTATGACTTAGAAGGTATTGAAATAGGGTCTTCAGCTC
GGAAAATTGCTGTCTACGATCCTGAGATTGAAACTTACGGTCAATTTAAAATGCGATTGCCGTTACCAGAATCTGAATTT
AATCAATATTTTAAGAATAATCGTACTCCTATCAGTGTTACTATTGATTACTTAAAAGAACTATTAATTTCTCCAGATAA
TGACTATAGTTTTACTAAAGAACAAGGAGAAATTTCACGTTTAGTTGTTTCAGTGCCAGAAATTTGGCAGCGGGATATTT
ATAATCTCGGTAGGGAACGTTTACAGGAGTTAATTAAGAAAGATTTAGGATTAGAAAAACAACTAATTCAACTGGTAAGC
GAACCTATAGCAGCAGCATCTTATTATGCTTGGGAAATGCAGCGTCGTGCTCAGGAAGAAAATACTAATCCTTTTCAGGG
TAACTTATTAGTTTGCGACATGGGAGGTGGGACATTTGATGTGAGTTTATGTCGAATTTATAGCAACAATAAAATTGAAG
TTCTCTACTTTGATGGAGAAGGAGATAAAGGGTTAGAATCTGCTGGGGTTGCTTTCGATAAAAATATTGTTCAAATAGCA
TATCAAAAACAATTTGGTGAACAGATTCAGGAAAATGATTCAAAGTTTATTCGCTTACTTAGAGAATTTGAAAATGTTAA
AATTGCTAATCATGTAAAAGCTACTAGAAGACTCATAAATTATTTGGATGCTCCAGAAGACAAAGCTAATGATGAAGCTT
ATAAATTTGGTGAAGGATATTCGGTTTCTTTAGAGGAGGTTCAGAAAGCATTTACTCCTATTGCTCAAGGAATTCAAAAA
GTTATGAAACGAGTTATTGAGCAAATTAAAATCCAAGGTTATTCAATAGATCGTTTATTTATGGTGGGTGGATTTTCTCA
GTTTATTTTAGTGCAAGAAGAGATTAAAAATATTTTGGGTTTTGAGAGAAATGATGTGCGAATTGAGCAAAGTTTTAATA
TTACTAATAGTGCTTATGCTATCTCTTATGGTGCTTGTTTGATTGCTAATGGTTTAGTTGAGCCTACAGAAAAATATGTT
CATACTTTAGGTATTATCTTAGAAACAATTGCTCTTACAGGAGAAAGAGATAAAATAAATATTCCTTTGATTAAAGGAGG
TTCTAGTTTAGATAGTTTGGCAGAGACAAATTTTTATGAGAAAGAAATTGAACCAATAGAACGACGAGTAACTGTTACTT
TGTGGGTCCAAATTCAATCTAAAGGTTTTAAACATCAAAACTCTCTGGCAGATATGATTGAGTTACCTAATTATTCTCCT
AATACAAAATATCGAGTTGGTATGAAGGTAGACCGCTCTCACATAGCTTATTTAGTAATCGAAAGTCAAGGAGGAGAAAG
CAAAATTGAATATGAGTTGGGTGAGATAATTTCTAAAATGTTTCCTGGTTATATACTCAAACCTGATGAGGATTGA

Upstream 100 bases:

>100_bases
GCGATCAAAAAAATCCCTAACTGAACTATATGGTTCTATAGACTCATTTACTTTCTCTCTTCCTTTTTCCTTCTTCCTAC
TTTTTTCTTCTTTATATATT

Downstream 100 bases:

>100_bases
AAATATAATATTTGTCTGATATTTACCTACTATACCTATTATTAAGTGATGAATTTACTACCAGAACAACAACAAGAAAT
GCAACAAGAAATACAACGAT

Product: molecular chaperone-like

Products: NA

Alternate protein names: HSP70; Heat shock 70 kDa protein; Heat shock protein 70 [H]

Number of amino acids: Translated: 531; Mature: 531

Protein sequence:

>531_residues
MKIGLDFGTTNSIISFITNDKPEAYSYPPLNGEKYIPSFIAYDLEGIEIGSSARKIAVYDPEIETYGQFKMRLPLPESEF
NQYFKNNRTPISVTIDYLKELLISPDNDYSFTKEQGEISRLVVSVPEIWQRDIYNLGRERLQELIKKDLGLEKQLIQLVS
EPIAAASYYAWEMQRRAQEENTNPFQGNLLVCDMGGGTFDVSLCRIYSNNKIEVLYFDGEGDKGLESAGVAFDKNIVQIA
YQKQFGEQIQENDSKFIRLLREFENVKIANHVKATRRLINYLDAPEDKANDEAYKFGEGYSVSLEEVQKAFTPIAQGIQK
VMKRVIEQIKIQGYSIDRLFMVGGFSQFILVQEEIKNILGFERNDVRIEQSFNITNSAYAISYGACLIANGLVEPTEKYV
HTLGIILETIALTGERDKINIPLIKGGSSLDSLAETNFYEKEIEPIERRVTVTLWVQIQSKGFKHQNSLADMIELPNYSP
NTKYRVGMKVDRSHIAYLVIESQGGESKIEYELGEIISKMFPGYILKPDED

Sequences:

>Translated_531_residues
MKIGLDFGTTNSIISFITNDKPEAYSYPPLNGEKYIPSFIAYDLEGIEIGSSARKIAVYDPEIETYGQFKMRLPLPESEF
NQYFKNNRTPISVTIDYLKELLISPDNDYSFTKEQGEISRLVVSVPEIWQRDIYNLGRERLQELIKKDLGLEKQLIQLVS
EPIAAASYYAWEMQRRAQEENTNPFQGNLLVCDMGGGTFDVSLCRIYSNNKIEVLYFDGEGDKGLESAGVAFDKNIVQIA
YQKQFGEQIQENDSKFIRLLREFENVKIANHVKATRRLINYLDAPEDKANDEAYKFGEGYSVSLEEVQKAFTPIAQGIQK
VMKRVIEQIKIQGYSIDRLFMVGGFSQFILVQEEIKNILGFERNDVRIEQSFNITNSAYAISYGACLIANGLVEPTEKYV
HTLGIILETIALTGERDKINIPLIKGGSSLDSLAETNFYEKEIEPIERRVTVTLWVQIQSKGFKHQNSLADMIELPNYSP
NTKYRVGMKVDRSHIAYLVIESQGGESKIEYELGEIISKMFPGYILKPDED
>Mature_531_residues
MKIGLDFGTTNSIISFITNDKPEAYSYPPLNGEKYIPSFIAYDLEGIEIGSSARKIAVYDPEIETYGQFKMRLPLPESEF
NQYFKNNRTPISVTIDYLKELLISPDNDYSFTKEQGEISRLVVSVPEIWQRDIYNLGRERLQELIKKDLGLEKQLIQLVS
EPIAAASYYAWEMQRRAQEENTNPFQGNLLVCDMGGGTFDVSLCRIYSNNKIEVLYFDGEGDKGLESAGVAFDKNIVQIA
YQKQFGEQIQENDSKFIRLLREFENVKIANHVKATRRLINYLDAPEDKANDEAYKFGEGYSVSLEEVQKAFTPIAQGIQK
VMKRVIEQIKIQGYSIDRLFMVGGFSQFILVQEEIKNILGFERNDVRIEQSFNITNSAYAISYGACLIANGLVEPTEKYV
HTLGIILETIALTGERDKINIPLIKGGSSLDSLAETNFYEKEIEPIERRVTVTLWVQIQSKGFKHQNSLADMIELPNYSP
NTKYRVGMKVDRSHIAYLVIESQGGESKIEYELGEIISKMFPGYILKPDED

Specific function: Acts as a chaperone [H]

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the heat shock protein 70 family [H]

Homologues:

Organism=Homo sapiens, GI16507237, Length=418, Percent_Identity=25.1196172248804, Blast_Score=78, Evalue=2e-14,
Organism=Caenorhabditis elegans, GI17534771, Length=439, Percent_Identity=25.0569476082005, Blast_Score=70, Evalue=2e-12,
Organism=Caenorhabditis elegans, GI17568549, Length=418, Percent_Identity=25.3588516746411, Blast_Score=69, Evalue=8e-12,
Organism=Saccharomyces cerevisiae, GI6322426, Length=511, Percent_Identity=23.091976516634, Blast_Score=81, Evalue=4e-16,
Organism=Drosophila melanogaster, GI24641406, Length=421, Percent_Identity=25.41567695962, Blast_Score=67, Evalue=4e-11,
Organism=Drosophila melanogaster, GI24641408, Length=421, Percent_Identity=25.41567695962, Blast_Score=67, Evalue=4e-11,
Organism=Drosophila melanogaster, GI24641402, Length=421, Percent_Identity=25.41567695962, Blast_Score=67, Evalue=4e-11,
Organism=Drosophila melanogaster, GI24641404, Length=421, Percent_Identity=25.41567695962, Blast_Score=67, Evalue=4e-11,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR012725
- InterPro:   IPR018181
- InterPro:   IPR001023
- InterPro:   IPR013126 [H]

Pfam domain/function: PF00012 HSP70 [H]

EC number: NA

Molecular weight: Translated: 60517; Mature: 60517

Theoretical pI: Translated: 4.66; Mature: 4.66

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.6 %Cys     (Translated Protein)
1.7 %Met     (Translated Protein)
2.3 %Cys+Met (Translated Protein)
0.6 %Cys     (Mature Protein)
1.7 %Met     (Mature Protein)
2.3 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKIGLDFGTTNSIISFITNDKPEAYSYPPLNGEKYIPSFIAYDLEGIEIGSSARKIAVYD
CEEECCCCCHHHHHHHHCCCCCCCCCCCCCCCCCCCCHHHHCCCCCEEECCCCCEEEEEC
PEIETYGQFKMRLPLPESEFNQYFKNNRTPISVTIDYLKELLISPDNDYSFTKEQGEISR
CCCCCCCCEEEECCCCHHHHHHHHHCCCCEEEEEHHHHHHHHCCCCCCCCCCCCCCHHHH
LVVSVPEIWQRDIYNLGRERLQELIKKDLGLEKQLIQLVSEPIAAASYYAWEMQRRAQEE
HHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHC
NTNPFQGNLLVCDMGGGTFDVSLCRIYSNNKIEVLYFDGEGDKGLESAGVAFDKNIVQIA
CCCCCCCCEEEEECCCCEEEEEEEEEECCCEEEEEEEECCCCCCCHHCCCEECCHHHHHH
YQKQFGEQIQENDSKFIRLLREFENVKIANHVKATRRLINYLDAPEDKANDEAYKFGEGY
HHHHHHHHHHHCHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHCCCCCCCCCCHHCCCCCC
SVSLEEVQKAFTPIAQGIQKVMKRVIEQIKIQGYSIDRLFMVGGFSQFILVQEEIKNILG
EEEHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEEEEECCCHHHEEEHHHHHHHHC
FERNDVRIEQSFNITNSAYAISYGACLIANGLVEPTEKYVHTLGIILETIALTGERDKIN
CCCCCEEEEEECCCCCCEEEEECCHHHHHCCCCCHHHHHHHHHHHHHHHHHHCCCCCEEE
IPLIKGGSSLDSLAETNFYEKEIEPIERRVTVTLWVQIQSKGFKHQNSLADMIELPNYSP
EEEEECCCCHHHHHHCCCHHHHHHHHHCEEEEEEEEEEECCCCCCHHHHHHHHHCCCCCC
NTKYRVGMKVDRSHIAYLVIESQGGESKIEYELGEIISKMFPGYILKPDED
CCEEEEEEEECCCEEEEEEEECCCCCCHHHHHHHHHHHHHCCCEEECCCCC
>Mature Secondary Structure
MKIGLDFGTTNSIISFITNDKPEAYSYPPLNGEKYIPSFIAYDLEGIEIGSSARKIAVYD
CEEECCCCCHHHHHHHHCCCCCCCCCCCCCCCCCCCCHHHHCCCCCEEECCCCCEEEEEC
PEIETYGQFKMRLPLPESEFNQYFKNNRTPISVTIDYLKELLISPDNDYSFTKEQGEISR
CCCCCCCCEEEECCCCHHHHHHHHHCCCCEEEEEHHHHHHHHCCCCCCCCCCCCCCHHHH
LVVSVPEIWQRDIYNLGRERLQELIKKDLGLEKQLIQLVSEPIAAASYYAWEMQRRAQEE
HHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHC
NTNPFQGNLLVCDMGGGTFDVSLCRIYSNNKIEVLYFDGEGDKGLESAGVAFDKNIVQIA
CCCCCCCCEEEEECCCCEEEEEEEEEECCCEEEEEEEECCCCCCCHHCCCEECCHHHHHH
YQKQFGEQIQENDSKFIRLLREFENVKIANHVKATRRLINYLDAPEDKANDEAYKFGEGY
HHHHHHHHHHHCHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHCCCCCCCCCCHHCCCCCC
SVSLEEVQKAFTPIAQGIQKVMKRVIEQIKIQGYSIDRLFMVGGFSQFILVQEEIKNILG
EEEHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEEEEECCCHHHEEEHHHHHHHHC
FERNDVRIEQSFNITNSAYAISYGACLIANGLVEPTEKYVHTLGIILETIALTGERDKIN
CCCCCEEEEEECCCCCCEEEEECCHHHHHCCCCCHHHHHHHHHHHHHHHHHHCCCCCEEE
IPLIKGGSSLDSLAETNFYEKEIEPIERRVTVTLWVQIQSKGFKHQNSLADMIELPNYSP
EEEEECCCCHHHHHHCCCHHHHHHHHHCEEEEEEEEEEECCCCCCHHHHHHHHHCCCCCC
NTKYRVGMKVDRSHIAYLVIESQGGESKIEYELGEIISKMFPGYILKPDED
CCEEEEEEEECCCEEEEEEEECCCCCCHHHHHHHHHHHHHCCCEEECCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA