| Definition | Herpetosiphon aurantiacus ATCC 23779 chromosome, complete genome. |
|---|---|
| Accession | NC_009972 |
| Length | 6,346,587 |
Click here to switch to the map view.
The map label for this gene is htpG [H]
Identifier: 159896855
GI number: 159896855
Start: 383077
End: 384951
Strand: Direct
Name: htpG [H]
Synonym: Haur_0322
Alternate gene names: 159896855
Gene position: 383077-384951 (Clockwise)
Preceding gene: 159896851
Following gene: 159896856
Centisome position: 6.04
GC content: 51.09
Gene sequence:
>1875_bases ATGGCTGAGCAACACGATGTTGCCAATGAGCGCGAACAGTTTCAATTCCAGGCTGAAATCCAACAAGTTTTGCATATTCT GATTCACTCGCTGTATACCCACCGCGAGATTTTTGTGCGCGAATTAATCTCGAATGCTTCCGATGCCTTGAATCGGGTGC AATTTGAGATGTTGACCAACCAAGATGTGCGCGACCCCGAGCTTGAATTGGCGATCACGTTGGAAGCCGATAAAGATGCG CGGATCATTCGGATCAGCGATACGGGTATCGGCATGACCCGCGATGATATGATCAAGAATTTGGGCACGGTGGCGCAATC TGGCGCGAAAGCCTTTTTGCAAAAGTTGGGCGAAGCCAACCCAACCAACAGCAGCGAAATTATTGGTCAATTTGGCGTAG GCTTCTACTCGGTGTTTATGGCTGCCGATGAAGTGCGGGTCACCTCGCTGTCGTATCAGCCCGATGCAACTGCTTGGCGC TGGACATCGCGCGGCGAAGCAACCTACACCTTGGAAGCAGCCGAACGCAGCGAACGCGGCACGACGATCGAAATTGTGCT CAAAGAAGATGCCGAAGAATATGCCGAACGCTGGAAACTTGACCAAATTGTGCGCCAACACTCCAATTTTGTGGCCTTCC CAATTTATTCGGCTGAGGGCGACGAAAAGAAAGTGCTCAACCAACGCACGGCGCTTTGGCGCAAGCAGCCACGCGAAGTC ACCCAAGAAGAATATAACGATTTCTATCGCCAAACCACGATGGATTTCAACGAGCCATTGAGCACAATTCACATTAGTAC CGATGCTCCGGTCGATTTGCACGCAATTTTGTTCTTGCCCGCCAAACGTGAGCAAGGCATGATGCGCCAAATTCCTGATC CAGGTTTGAAACTTTATTCGCGCAAGGTGCTGATCCAAGAGCGCAACGAAGAATTGTTGCCCAAACATCTGCGCTTTGTC CAAGGTGTGGTCGATTCGGAAGATTTGCCGTTGAATGTCTCGCGTGAAACCGTGCAAAGCAGCGGCACATTACGCCAAAT TGCCAAAATTGTGACCAACAAAATTACCAAAGAAATTGAAACCTTGGCCGAAAACGATGCCGAAAAGTTTGCTGACTTCT GGCGTGAATTTGGGCCATATTTCAAAGAAGGCTTGGTTACCGATCCTGGCACGCGCAGCCAAATTGAGCCACTATTGCGC TTCCACTCGACCAGCGGCGAGGGCTTGACCAAGCTCAGCGAGTATGTTGAGCGCATGAAGGAAGGCCAAGAAGATATTTA TTATGTGATTGCCGACAACGTGGAAACTGCCCGCCGTTCGCCACATCTCGATTATTTCAACGAACGCGGCTACGAAGTGC TGTTGATGCATGAAACGATTGATAGCTTTGTCATCTCCAGTTTGCGCGATTTCCAAGGCAAAAAATTGCGCTCAGTCGAT GATGCCGATATTGCGGGCGACGATGTTGAGCTAGAAGGCTCGCTCTCAGCAGCAACGCTTGGCCAACTGGGCGACCGCAT CAAAGAATTATTGGGCGAGCAAATCAGCGAAGTGCGTGGCTCGAAGTTGCTGCGCAGCAACCCTGTGCGTTTGGCCGCGC CTAGCGACGATTTTGGCCGCGATATGGATCGCATTCGGCGTATGATGGGTCAAGAATATAGCGTTCCTAGCCGAATTCTA GAACTCAACCCACGCCACGCGATTGTGCACAACTTGGCCGCCTTGCTCGATGAGCCAGATCAAGCCGAATTGTTCGAGGT TGCGGTGCAACAATTGTATGGCACGGCTTTGTTGGGCGAAGGCTTACACCCCAACCCCAGCGAGTTGATCAGCGGTGTCC ATGCCTTGATCGCTGCCGCTACCAAAAAACAATAA
Upstream 100 bases:
>100_bases ACAACGCTAACGTAGCAAGCTTCTCGTGGTAGGCATGGCTATGCTACAATCGGCCTAGCGGTTTAAGCCCAATTAAGCGT TTTATAAGGAGTAGCGACCT
Downstream 100 bases:
>100_bases GTCTGAATGCCCTCACCCCAACCCCTCTCCCACTGCGGTGGGAGAGGGGCTTTTTGTTAAATCCCCAACTTGCGACTGAT TACGCCCCAAATCATTGTGA
Product: heat shock protein 90
Products: NA
Alternate protein names: Heat shock protein htpG; High temperature protein G [H]
Number of amino acids: Translated: 624; Mature: 623
Protein sequence:
>624_residues MAEQHDVANEREQFQFQAEIQQVLHILIHSLYTHREIFVRELISNASDALNRVQFEMLTNQDVRDPELELAITLEADKDA RIIRISDTGIGMTRDDMIKNLGTVAQSGAKAFLQKLGEANPTNSSEIIGQFGVGFYSVFMAADEVRVTSLSYQPDATAWR WTSRGEATYTLEAAERSERGTTIEIVLKEDAEEYAERWKLDQIVRQHSNFVAFPIYSAEGDEKKVLNQRTALWRKQPREV TQEEYNDFYRQTTMDFNEPLSTIHISTDAPVDLHAILFLPAKREQGMMRQIPDPGLKLYSRKVLIQERNEELLPKHLRFV QGVVDSEDLPLNVSRETVQSSGTLRQIAKIVTNKITKEIETLAENDAEKFADFWREFGPYFKEGLVTDPGTRSQIEPLLR FHSTSGEGLTKLSEYVERMKEGQEDIYYVIADNVETARRSPHLDYFNERGYEVLLMHETIDSFVISSLRDFQGKKLRSVD DADIAGDDVELEGSLSAATLGQLGDRIKELLGEQISEVRGSKLLRSNPVRLAAPSDDFGRDMDRIRRMMGQEYSVPSRIL ELNPRHAIVHNLAALLDEPDQAELFEVAVQQLYGTALLGEGLHPNPSELISGVHALIAAATKKQ
Sequences:
>Translated_624_residues MAEQHDVANEREQFQFQAEIQQVLHILIHSLYTHREIFVRELISNASDALNRVQFEMLTNQDVRDPELELAITLEADKDA RIIRISDTGIGMTRDDMIKNLGTVAQSGAKAFLQKLGEANPTNSSEIIGQFGVGFYSVFMAADEVRVTSLSYQPDATAWR WTSRGEATYTLEAAERSERGTTIEIVLKEDAEEYAERWKLDQIVRQHSNFVAFPIYSAEGDEKKVLNQRTALWRKQPREV TQEEYNDFYRQTTMDFNEPLSTIHISTDAPVDLHAILFLPAKREQGMMRQIPDPGLKLYSRKVLIQERNEELLPKHLRFV QGVVDSEDLPLNVSRETVQSSGTLRQIAKIVTNKITKEIETLAENDAEKFADFWREFGPYFKEGLVTDPGTRSQIEPLLR FHSTSGEGLTKLSEYVERMKEGQEDIYYVIADNVETARRSPHLDYFNERGYEVLLMHETIDSFVISSLRDFQGKKLRSVD DADIAGDDVELEGSLSAATLGQLGDRIKELLGEQISEVRGSKLLRSNPVRLAAPSDDFGRDMDRIRRMMGQEYSVPSRIL ELNPRHAIVHNLAALLDEPDQAELFEVAVQQLYGTALLGEGLHPNPSELISGVHALIAAATKKQ >Mature_623_residues AEQHDVANEREQFQFQAEIQQVLHILIHSLYTHREIFVRELISNASDALNRVQFEMLTNQDVRDPELELAITLEADKDAR IIRISDTGIGMTRDDMIKNLGTVAQSGAKAFLQKLGEANPTNSSEIIGQFGVGFYSVFMAADEVRVTSLSYQPDATAWRW TSRGEATYTLEAAERSERGTTIEIVLKEDAEEYAERWKLDQIVRQHSNFVAFPIYSAEGDEKKVLNQRTALWRKQPREVT QEEYNDFYRQTTMDFNEPLSTIHISTDAPVDLHAILFLPAKREQGMMRQIPDPGLKLYSRKVLIQERNEELLPKHLRFVQ GVVDSEDLPLNVSRETVQSSGTLRQIAKIVTNKITKEIETLAENDAEKFADFWREFGPYFKEGLVTDPGTRSQIEPLLRF HSTSGEGLTKLSEYVERMKEGQEDIYYVIADNVETARRSPHLDYFNERGYEVLLMHETIDSFVISSLRDFQGKKLRSVDD ADIAGDDVELEGSLSAATLGQLGDRIKELLGEQISEVRGSKLLRSNPVRLAAPSDDFGRDMDRIRRMMGQEYSVPSRILE LNPRHAIVHNLAALLDEPDQAELFEVAVQQLYGTALLGEGLHPNPSELISGVHALIAAATKKQ
Specific function: Molecular chaperone. Has ATPase activity [H]
COG id: COG0326
COG function: function code O; Molecular chaperone, HSP90 family
Gene ontology:
Cell location: Cytoplasm [H]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the heat shock protein 90 family [H]
Homologues:
Organism=Homo sapiens, GI155722983, Length=644, Percent_Identity=35.2484472049689, Blast_Score=379, Evalue=1e-105, Organism=Homo sapiens, GI4507677, Length=660, Percent_Identity=32.2727272727273, Blast_Score=357, Evalue=2e-98, Organism=Homo sapiens, GI20149594, Length=392, Percent_Identity=34.4387755102041, Blast_Score=210, Evalue=3e-54, Organism=Homo sapiens, GI154146191, Length=392, Percent_Identity=31.6326530612245, Blast_Score=197, Evalue=2e-50, Organism=Homo sapiens, GI153792590, Length=390, Percent_Identity=31.025641025641, Blast_Score=196, Evalue=8e-50, Organism=Escherichia coli, GI1786679, Length=622, Percent_Identity=37.9421221864952, Blast_Score=439, Evalue=1e-124, Organism=Caenorhabditis elegans, GI115535205, Length=635, Percent_Identity=36.0629921259843, Blast_Score=362, Evalue=1e-100, Organism=Caenorhabditis elegans, GI17559162, Length=649, Percent_Identity=32.9738058551618, Blast_Score=358, Evalue=6e-99, Organism=Caenorhabditis elegans, GI17542208, Length=651, Percent_Identity=33.3333333333333, Blast_Score=346, Evalue=2e-95, Organism=Caenorhabditis elegans, GI115535167, Length=425, Percent_Identity=41.4117647058824, Blast_Score=305, Evalue=4e-83, Organism=Saccharomyces cerevisiae, GI6325016, Length=405, Percent_Identity=32.8395061728395, Blast_Score=211, Evalue=2e-55, Organism=Saccharomyces cerevisiae, GI6323840, Length=405, Percent_Identity=32.3456790123457, Blast_Score=207, Evalue=3e-54, Organism=Drosophila melanogaster, GI24586016, Length=642, Percent_Identity=36.2928348909657, Blast_Score=384, Evalue=1e-106, Organism=Drosophila melanogaster, GI17647529, Length=664, Percent_Identity=33.2831325301205, Blast_Score=361, Evalue=1e-100, Organism=Drosophila melanogaster, GI21357739, Length=670, Percent_Identity=31.4925373134328, Blast_Score=343, Evalue=1e-94,
Paralogues:
None
Copy number: 640 Molecules/Cell In: Growth-Phase, Minimal-Media (Based on E. coli). 2419 Molecules/Cell In: Growth Phase, Glucose-minimal MOPS Media. 2,000 Molecules/Cell In: Glucose minimal media [C]
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR003594 - InterPro: IPR001404 - InterPro: IPR020575 - InterPro: IPR020568 [H]
Pfam domain/function: PF02518 HATPase_c; PF00183 HSP90 [H]
EC number: NA
Molecular weight: Translated: 70800; Mature: 70668
Theoretical pI: Translated: 4.73; Mature: 4.73
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.0 %Cys (Translated Protein) 2.1 %Met (Translated Protein) 2.1 %Cys+Met (Translated Protein) 0.0 %Cys (Mature Protein) 1.9 %Met (Mature Protein) 1.9 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MAEQHDVANEREQFQFQAEIQQVLHILIHSLYTHREIFVRELISNASDALNRVQFEMLTN CCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCC QDVRDPELELAITLEADKDARIIRISDTGIGMTRDDMIKNLGTVAQSGAKAFLQKLGEAN CCCCCCCEEEEEEEECCCCCEEEEEECCCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCC PTNSSEIIGQFGVGFYSVFMAADEVRVTSLSYQPDATAWRWTSRGEATYTLEAAERSERG CCCHHHHHHHHHHHHHHHHHHHCCEEEEEECCCCCCCEEEECCCCCEEEEEECHHHCCCC TTIEIVLKEDAEEYAERWKLDQIVRQHSNFVAFPIYSAEGDEKKVLNQRTALWRKQPREV CEEEEEECCCHHHHHHHHHHHHHHHHCCCEEEEEEECCCCCHHHHHHHHHHHHHHCCHHH TQEEYNDFYRQTTMDFNEPLSTIHISTDAPVDLHAILFLPAKREQGMMRQIPDPGLKLYS HHHHHHHHHHHHHCCCCCCCCEEEECCCCCCCEEEEEEEECHHHCCHHHCCCCCCHHHHH RKVLIQERNEELLPKHLRFVQGVVDSEDLPLNVSRETVQSSGTLRQIAKIVTNKITKEIE HHHHHHHCCHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHCCCHHHHHHHHHHHHHHHHHH TLAENDAEKFADFWREFGPYFKEGLVTDPGTRSQIEPLLRFHSTSGEGLTKLSEYVERMK HHHHCCHHHHHHHHHHHCHHHHCCCCCCCCCHHHHHHHHHHHCCCCCHHHHHHHHHHHHH EGQEDIYYVIADNVETARRSPHLDYFNERGYEVLLMHETIDSFVISSLRDFQGKKLRSVD CCCCCEEEEEECCHHHHHCCCCCCCCCCCCCEEEEEHHHHHHHHHHHHHHHCCCCCCCCC DADIAGDDVELEGSLSAATLGQLGDRIKELLGEQISEVRGSKLLRSNPVRLAAPSDDFGR CCCCCCCCEEECCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEECCCCHHHH DMDRIRRMMGQEYSVPSRILELNPRHAIVHNLAALLDEPDQAELFEVAVQQLYGTALLGE HHHHHHHHHCCCCCCCHHHHHCCCHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHCC GLHPNPSELISGVHALIAAATKKQ CCCCCHHHHHHHHHHHHHHHHCCC >Mature Secondary Structure AEQHDVANEREQFQFQAEIQQVLHILIHSLYTHREIFVRELISNASDALNRVQFEMLTN CCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCC QDVRDPELELAITLEADKDARIIRISDTGIGMTRDDMIKNLGTVAQSGAKAFLQKLGEAN CCCCCCCEEEEEEEECCCCCEEEEEECCCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCC PTNSSEIIGQFGVGFYSVFMAADEVRVTSLSYQPDATAWRWTSRGEATYTLEAAERSERG CCCHHHHHHHHHHHHHHHHHHHCCEEEEEECCCCCCCEEEECCCCCEEEEEECHHHCCCC TTIEIVLKEDAEEYAERWKLDQIVRQHSNFVAFPIYSAEGDEKKVLNQRTALWRKQPREV CEEEEEECCCHHHHHHHHHHHHHHHHCCCEEEEEEECCCCCHHHHHHHHHHHHHHCCHHH TQEEYNDFYRQTTMDFNEPLSTIHISTDAPVDLHAILFLPAKREQGMMRQIPDPGLKLYS HHHHHHHHHHHHHCCCCCCCCEEEECCCCCCCEEEEEEEECHHHCCHHHCCCCCCHHHHH RKVLIQERNEELLPKHLRFVQGVVDSEDLPLNVSRETVQSSGTLRQIAKIVTNKITKEIE HHHHHHHCCHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHCCCHHHHHHHHHHHHHHHHHH TLAENDAEKFADFWREFGPYFKEGLVTDPGTRSQIEPLLRFHSTSGEGLTKLSEYVERMK HHHHCCHHHHHHHHHHHCHHHHCCCCCCCCCHHHHHHHHHHHCCCCCHHHHHHHHHHHHH EGQEDIYYVIADNVETARRSPHLDYFNERGYEVLLMHETIDSFVISSLRDFQGKKLRSVD CCCCCEEEEEECCHHHHHCCCCCCCCCCCCCEEEEEHHHHHHHHHHHHHHHCCCCCCCCC DADIAGDDVELEGSLSAATLGQLGDRIKELLGEQISEVRGSKLLRSNPVRLAAPSDDFGR CCCCCCCCEEECCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEECCCCHHHH DMDRIRRMMGQEYSVPSRILELNPRHAIVHNLAALLDEPDQAELFEVAVQQLYGTALLGE HHHHHHHHHCCCCCCCHHHHHCCCHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHCC GLHPNPSELISGVHALIAAATKKQ CCCCCHHHHHHHHHHHHHHHHCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: NA