Definition Tropheryma whipplei TW08/27, complete genome.
Accession NC_004551
Length 925,938

Click here to switch to the map view.

The map label for this gene is clpX

Identifier: 28572441

GI number: 28572441

Start: 320051

End: 321322

Strand: Direct

Name: clpX

Synonym: TW285

Alternate gene names: 28572441

Gene position: 320051-321322 (Clockwise)

Preceding gene: 28572440

Following gene: 28572443

Centisome position: 34.57

GC content: 45.91

Gene sequence:

>1272_bases
TTGACGGATGATACCGAATATCGGTGTTCTTTTTGCGGAAAGGAACACCATCAGGTTGATGATCTGATAGCCGGTCCGGA
TGTGCGTATATGCAGCGAGTGTGTTGTTCTGAGCTGCGAGATTGTTGAGGATAGAAGAAATGAGGCTCTTGCGAAGCAAG
ATGCTTTTATCAAGAGAAAACAGCGGTCAGTTCTTGAGGGCTTACCGAAACCCGCTGAGATATATGCCTTTCTTGATGAG
TATGTAATTGGTCAGCAGAAGGCAAAGCGTGATTTGTCGGTTGCGGTTTATAACCATTACAAGAGGCTTGTCTCGACAAA
AAGTGAGAGCGAAAATGAAGTTGAGCTCTCCAAGTCAAATATTCTACTGATTGGCCCTACAGGTTGTGGCAAAACTTACC
TCGCACAAACCCTCGCTCGGATGCTTCGTGTTCCCTTTGCTGTCGCCGATGCAACAGCTTTGACAGAGGCGGGATATGTC
GGGGATGATGTTGAAAATGTCCTCTTAAAACTTTTACAGGACGCTGATTTTGATATTACTCGCGCCGAGGCGGGTATCGT
ATGCATAGATGAGATTGACAAAATATCTCGCAAGGCCGACAGTCCCTCAATTACGCGGGATGTTTCAGGAGAGGGTGTTC
AACAGGCTCTCCTGAAAATTCTAGAGGGTACGGCAGCGTCTGTTCCTTTGCAAGGTGGTAAAAAGCATACCCAATACGAA
CAGGCCAGCATAAACACGAGGAATATTCTTTTTATTGTTGCAGGCGCTTTTTCCGGGATAGAGGAAATTATTTCATCTCG
TATCGGCAGATCTAACATGGGCTTCGGGTCGGATTTGCTTAGGAAAGATACGGATGTATTTGACCAGATTTTACCCGAGG
ACTTGAGAAAATTTGGGCTTATTCCGGAGTTTATTGGCCGCCTTCCGATTGTTACAGCAATTTCTCATCTTGACGGAGAG
GATATGATTCGGGTTTTGACCGAGCCTAAGAATGCACTTGTAAAGCAGTACAAAAGGCTTTTTTCGCTCGATGGGGTTTC
TCTTGGGTTTGACCACGAAGCGCTTGAGGCAATAGTAGAATTGGCACTCAAAAGAAAAACTGGCGCACGAGCATTGCGCT
CTGTCATGGAATCGATTTTGAGCCCCATAATGTTTGATGTTCCATCAAGAGGTGATATCGAAAGTGTCCGAATAACTGCC
GAAACAGTTGCAGGTGGTGGCCCGCATCTTACGATGCGATGTGCTAGGTCTAATTACATCAGATCAGCGTGA

Upstream 100 bases:

>100_bases
TGATAAGATCCTTTCTTCCGAGCAGGCTTTGGAATATGGCTTGATTGATCAGATATTGGTTAGTCGTAAAGCTGGCCTGG
GTAAGAAATAGGGGTTATGC

Downstream 100 bases:

>100_bases
TATCTCTCCGTACTCTATCGCGAGAATCTGAGCGTCCCCGTCGATAAGCTCACATTTGTCGATTTTTCCCGCTCTCCGCA
AGTCATCCATTATTGGCATA

Product: ATP-dependent protease ATP-binding subunit ClpX

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 423; Mature: 422

Protein sequence:

>423_residues
MTDDTEYRCSFCGKEHHQVDDLIAGPDVRICSECVVLSCEIVEDRRNEALAKQDAFIKRKQRSVLEGLPKPAEIYAFLDE
YVIGQQKAKRDLSVAVYNHYKRLVSTKSESENEVELSKSNILLIGPTGCGKTYLAQTLARMLRVPFAVADATALTEAGYV
GDDVENVLLKLLQDADFDITRAEAGIVCIDEIDKISRKADSPSITRDVSGEGVQQALLKILEGTAASVPLQGGKKHTQYE
QASINTRNILFIVAGAFSGIEEIISSRIGRSNMGFGSDLLRKDTDVFDQILPEDLRKFGLIPEFIGRLPIVTAISHLDGE
DMIRVLTEPKNALVKQYKRLFSLDGVSLGFDHEALEAIVELALKRKTGARALRSVMESILSPIMFDVPSRGDIESVRITA
ETVAGGGPHLTMRCARSNYIRSA

Sequences:

>Translated_423_residues
MTDDTEYRCSFCGKEHHQVDDLIAGPDVRICSECVVLSCEIVEDRRNEALAKQDAFIKRKQRSVLEGLPKPAEIYAFLDE
YVIGQQKAKRDLSVAVYNHYKRLVSTKSESENEVELSKSNILLIGPTGCGKTYLAQTLARMLRVPFAVADATALTEAGYV
GDDVENVLLKLLQDADFDITRAEAGIVCIDEIDKISRKADSPSITRDVSGEGVQQALLKILEGTAASVPLQGGKKHTQYE
QASINTRNILFIVAGAFSGIEEIISSRIGRSNMGFGSDLLRKDTDVFDQILPEDLRKFGLIPEFIGRLPIVTAISHLDGE
DMIRVLTEPKNALVKQYKRLFSLDGVSLGFDHEALEAIVELALKRKTGARALRSVMESILSPIMFDVPSRGDIESVRITA
ETVAGGGPHLTMRCARSNYIRSA
>Mature_422_residues
TDDTEYRCSFCGKEHHQVDDLIAGPDVRICSECVVLSCEIVEDRRNEALAKQDAFIKRKQRSVLEGLPKPAEIYAFLDEY
VIGQQKAKRDLSVAVYNHYKRLVSTKSESENEVELSKSNILLIGPTGCGKTYLAQTLARMLRVPFAVADATALTEAGYVG
DDVENVLLKLLQDADFDITRAEAGIVCIDEIDKISRKADSPSITRDVSGEGVQQALLKILEGTAASVPLQGGKKHTQYEQ
ASINTRNILFIVAGAFSGIEEIISSRIGRSNMGFGSDLLRKDTDVFDQILPEDLRKFGLIPEFIGRLPIVTAISHLDGED
MIRVLTEPKNALVKQYKRLFSLDGVSLGFDHEALEAIVELALKRKTGARALRSVMESILSPIMFDVPSRGDIESVRITAE
TVAGGGPHLTMRCARSNYIRSA

Specific function: ATP-dependent specificity component of the Clp protease. It directs the protease to specific substrates. Can perform chaperone functions in the absence of ClpP

COG id: COG1219

COG function: function code O; ATP-dependent protease Clp, ATPase subunit

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the ClpX chaperone family

Homologues:

Organism=Homo sapiens, GI7242140, Length=324, Percent_Identity=47.2222222222222, Blast_Score=280, Evalue=2e-75,
Organism=Escherichia coli, GI1786642, Length=403, Percent_Identity=56.3275434243176, Blast_Score=436, Evalue=1e-123,
Organism=Escherichia coli, GI1790366, Length=114, Percent_Identity=40.3508771929825, Blast_Score=91, Evalue=1e-19,
Organism=Caenorhabditis elegans, GI71982908, Length=314, Percent_Identity=45.859872611465, Blast_Score=272, Evalue=2e-73,
Organism=Caenorhabditis elegans, GI71982905, Length=314, Percent_Identity=45.859872611465, Blast_Score=272, Evalue=2e-73,
Organism=Caenorhabditis elegans, GI71988663, Length=405, Percent_Identity=38.2716049382716, Blast_Score=234, Evalue=6e-62,
Organism=Caenorhabditis elegans, GI71988660, Length=250, Percent_Identity=40.4, Blast_Score=163, Evalue=2e-40,
Organism=Saccharomyces cerevisiae, GI6319704, Length=430, Percent_Identity=38.6046511627907, Blast_Score=265, Evalue=1e-71,
Organism=Drosophila melanogaster, GI24648291, Length=314, Percent_Identity=45.5414012738853, Blast_Score=274, Evalue=8e-74,
Organism=Drosophila melanogaster, GI24648289, Length=314, Percent_Identity=45.5414012738853, Blast_Score=274, Evalue=9e-74,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): CLPX_TROW8 (Q83MI6)

Other databases:

- EMBL:   BX251410
- RefSeq:   NP_789221.1
- ProteinModelPortal:   Q83MI6
- STRING:   Q83MI6
- GeneID:   1064574
- GenomeReviews:   BX072543_GR
- KEGG:   tws:TW285
- eggNOG:   COG1219
- HOGENOM:   HBG745965
- OMA:   CGKSQEQ
- PhylomeDB:   Q83MI6
- ProtClustDB:   PRK05342
- BioCyc:   TWHI218496:TW0266-MONOMER
- HAMAP:   MF_00175
- InterPro:   IPR003593
- InterPro:   IPR013093
- InterPro:   IPR019489
- InterPro:   IPR004487
- InterPro:   IPR010603
- PANTHER:   PTHR11262:SF4
- SMART:   SM00382
- TIGRFAMs:   TIGR00382

Pfam domain/function: PF07724 AAA_2; PF10431 ClpB_D2-small; PF06689 zf-C4_ClpX

EC number: NA

Molecular weight: Translated: 46564; Mature: 46433

Theoretical pI: Translated: 5.39; Mature: 5.39

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.9 %Cys     (Translated Protein)
1.7 %Met     (Translated Protein)
3.5 %Cys+Met (Translated Protein)
1.9 %Cys     (Mature Protein)
1.4 %Met     (Mature Protein)
3.3 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MTDDTEYRCSFCGKEHHQVDDLIAGPDVRICSECVVLSCEIVEDRRNEALAKQDAFIKRK
CCCCCCHHHHHCCCHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
QRSVLEGLPKPAEIYAFLDEYVIGQQKAKRDLSVAVYNHYKRLVSTKSESENEVELSKSN
HHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCEEECCCC
ILLIGPTGCGKTYLAQTLARMLRVPFAVADATALTEAGYVGDDVENVLLKLLQDADFDIT
EEEEECCCCCHHHHHHHHHHHHHCCHHHHHHHHHHHCCCCCCHHHHHHHHHHHCCCCCEE
RAEAGIVCIDEIDKISRKADSPSITRDVSGEGVQQALLKILEGTAASVPLQGGKKHTQYE
ECCCCEEEHHHHHHHHHCCCCCCCCCCCCCCHHHHHHHHHHCCCCCCCCCCCCCCCCCHH
QASINTRNILFIVAGAFSGIEEIISSRIGRSNMGFGSDLLRKDTDVFDQILPEDLRKFGL
HHCCCCCEEEEEEECHHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHCC
IPEFIGRLPIVTAISHLDGEDMIRVLTEPKNALVKQYKRLFSLDGVSLGFDHEALEAIVE
CHHHHCCCHHHHHHHHCCHHHHHHHHHCCHHHHHHHHHHHHHCCCCCCCCCHHHHHHHHH
LALKRKTGARALRSVMESILSPIMFDVPSRGDIESVRITAETVAGGGPHLTMRCARSNYI
HHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCEEEEHHHHCCCCCCEEEEEHHCCCC
RSA
CCC
>Mature Secondary Structure 
TDDTEYRCSFCGKEHHQVDDLIAGPDVRICSECVVLSCEIVEDRRNEALAKQDAFIKRK
CCCCCHHHHHCCCHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
QRSVLEGLPKPAEIYAFLDEYVIGQQKAKRDLSVAVYNHYKRLVSTKSESENEVELSKSN
HHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCEEECCCC
ILLIGPTGCGKTYLAQTLARMLRVPFAVADATALTEAGYVGDDVENVLLKLLQDADFDIT
EEEEECCCCCHHHHHHHHHHHHHCCHHHHHHHHHHHCCCCCCHHHHHHHHHHHCCCCCEE
RAEAGIVCIDEIDKISRKADSPSITRDVSGEGVQQALLKILEGTAASVPLQGGKKHTQYE
ECCCCEEEHHHHHHHHHCCCCCCCCCCCCCCHHHHHHHHHHCCCCCCCCCCCCCCCCCHH
QASINTRNILFIVAGAFSGIEEIISSRIGRSNMGFGSDLLRKDTDVFDQILPEDLRKFGL
HHCCCCCEEEEEEECHHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHCC
IPEFIGRLPIVTAISHLDGEDMIRVLTEPKNALVKQYKRLFSLDGVSLGFDHEALEAIVE
CHHHHCCCHHHHHHHHCCHHHHHHHHHCCHHHHHHHHHHHHHCCCCCCCCCHHHHHHHHH
LALKRKTGARALRSVMESILSPIMFDVPSRGDIESVRITAETVAGGGPHLTMRCARSNYI
HHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCEEEEHHHHCCCCCCEEEEEHHCCCC
RSA
CCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 12606174