Definition Yersinia pestis CO92 chromosome, complete genome.
Accession NC_003143
Length 4,653,728

Click here to switch to the map view.

The map label for this gene is clpV1 [H]

Identifier: 218928614

GI number: 218928614

Start: 1663153

End: 1665795

Strand: Direct

Name: clpV1 [H]

Synonym: YPO1471

Alternate gene names: 218928614

Gene position: 1663153-1665795 (Clockwise)

Preceding gene: 218928613

Following gene: 218928615

Centisome position: 35.74

GC content: 59.25

Gene sequence:

>2643_bases
ATGACAACGCATTCAGCACACTTATTACGTCGGTTAAATCCCTATTGCGCACAGGCACTGGCCGGTGCCGCCACCCTGTG
TCAGACCCGCGCCCATGCTGAGATCACTGTCGAACACTGGTTGTTAAAATTGCTGGAGCAGGGCGAAGGCGATATTACAG
TCATTGCCCGGCGTTATGAGTGGGACATGGACAGCCTGTGGCAGGGATTACTGTCCCATCTGGACACCTTGCCGCGCACG
GTACAGGGCAAACCTCAGTTGTCCGCCGCGTTACAGCAACTGATCAAAAACGCCTGGCTGGATGCCTCGTTGCAGGAAAA
TGCTGATGCGGTGCGCTCGGTTCATCTAATGGCAGCGCTGATTGCCACGCCGTCATTATTGGTCGCCGAGGCCGCCTGGC
CGTTGCTCAGCCTGAGCACCACTCAGCTACAGCGCCTGTTACCGCTGCTGGACAACCAGTCCGACGAACGCCCTGAGGTG
CAGCAGGCTGCGGCACTGGCCGACAGCCCGGTCAATCTGACCGATGAGGCCGCGACGGTTACCTCCGCCAGTGGTCAGCC
GCAACTGAATGACGCGCTGCAAGCGGCGCTGGATAAATTCACCCTCGACGTCACCGCCAAAGCCCGTGCCAACCAGATTG
ACCCGATTTTTGGCCGCGACAGCGAAATCCGCCAGATGATCGACATCCTGTCGCGCCGCCGTAAAAACAACCCGATTCTG
GTGGGTGAACCGGGTGTGGGGAAAACCGCGCTGGTTGAAGGGCTGGCACTGCGGATTGCCGACGGCAACGTACCGGACAG
CCTGAAAACCGTCAGTGTGCGCACACTGGATTTGGGTCTGTTACAGGCCGGGGCTGGGGTGAAAGGCGAATTCGAACAGC
GCCTGAAAAATGTTATCGAGGCGGTGCAACAATCCCCCAGCCCGGTGCTGCTGTTTATCGACGAAGCCCACACCATTATC
GGGGCCGGTAATCAGGCCGGTGGTGCCGATGCGGCCAACCTGCTGAAACCTGCACTGGCGCGTGGCGAACTGCGCACCAT
CGCCGCCACCACCTGGTCCGAATACAAACAGTATTTTGAACGCGATGCCGCACTGGAGCGCCGCTTCCAGATGGTCAAAG
TGGACGAGCCGGATGATGACACCGCCTGCCTGATGCTGCGTGGCCTGAAAGAACGTTACGCCACCCATCACGGCGTGCAT
ATTCTGGACGCCGCTATCACCGCAGCGGTTACCCTGTCGCGCCGCTTTCTGACCGGTCGCCAACTGCCGGACAAAGCGGT
GGATCTTCTCGACACCGCAGGTGCGCGCGTGCGCATGAGCATCGACACCTTGCCGACTGCGTTGATGGAGATTAACGCCG
AACTGGCCGCACTGGCGATGGAGCAACAGGCCATCGAACAGGACTTGCTCCTGCTGCCGAATGTCAGTTCAACGCGCTTA
CCTGAGATTGAGCAACGCCGCGCCGCGCTGGCGGTTGGGCAGCACACACTCGAACAGCAATATAAAGAAGAGAAGCGGTT
GACCACCCTGATTATTGAGGCGCGTCAGGACATCGCCAACGCAGCACATCTGGTCGCGTTGCAGGAGGAACTCGTTCAGA
TTCAGGGCAATGCGCCGCTGTTGTCGCTGGACGTTGATGTGCGCACTGTTGCGGCTGTGATCGCCGACTGGACCGGTGTG
CCGCTGGGCAGTTTACTCAAAGACGAACAAACCAACTTGCTGTCACTGGAAAATCGTCTGGGTGAGCGAGTGATTGGGCA
GGATGCGGCATTAGGTGCGCTGGCGCAACGGCTGCGGGCCGCCAAAACCGGCCTGACATCAGAGAATGGCCCGCTGGGGG
TGTTCCTGCTGGTCGGGCCGAGTGGGATCGGCAAAACCGAAACCGCGTTGGCACTGGCCGACAGCCTGTTCGGCGGGGAA
AAATCGCTGATCACCATCAACTTATCGGAGTATCAGGAAGCGCACACCGTCTCCCAGTTGAAAGGGTCGCCCCCGGGTTA
TGTCGGTTACGGACAGGGCGGCGTATTAACCGAAGCGGTACGTAAACGGCCTTACAGCGTGGTGCTGCTGGATGAAGTGG
AAAAAGCCCATCGTGATGTGCTGAACCTGTTCTATCAGGTGTTTGACCGGGGGTTCATGCGCGACGGTGAAGGGCGCGAA
ATTGATTTCCGCAACACGGTCATTGTGATGACCGCCAATCTGGGCAGTGATCATCTGATGCAGTTGCTGGATGAGCAACC
GGACGCGCCGGACAGCACCCTGCATGAACTGCTGCGGCCGATCCTACGCGACCACTTCCAGCCCGCGCTGCTGGCCCGCT
TCCAGACCTTGATTTACCGCCCGCTTCAGGTGGATGCGCTCAAACGCATTGTGGCGATAAAACTGAATCAGGTGGCGCAA
CGCCTGCACTGTCACTACGGCCTGAGCTGCCAGATTGAAGACAGCCTGACCGACACACTGGTCGCCGCCTGCCTGCTGCC
GGACACCGGCGCACGCAACATCGACAGCCTGCTCAATCAGCAGATTTTACCGGTATTGAGCCAGCAGCTGTTAAGCCGCA
TGAGCGAGCAACAGCGCACCACCTCGCTGACGCTGGGCTGGCATGAAGAAGATGGCATCACGCTGACATTTGAGGGCGAA
TAA

Upstream 100 bases:

>100_bases
ACCCTTTAATGACCTTATGGGCCTTGGTTTCCTTAGTAAAGGAAAGGCTACGGGCGGTAGCGTGTCCAAATAGGGTAAAT
GGCAAACAAGGAAGATCTTA

Downstream 100 bases:

>100_bases
AAATGAATACCTTTCTCCCGACTATTCGGTTTGACCATAGCCACCACAAACTGGTGGTCCGCGACAGCACCGCCGCCGTT
GATGTGCTGGGCTTTGAAGG

Product: putative ATPase subunit of ATP-dependent protease

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 880; Mature: 879

Protein sequence:

>880_residues
MTTHSAHLLRRLNPYCAQALAGAATLCQTRAHAEITVEHWLLKLLEQGEGDITVIARRYEWDMDSLWQGLLSHLDTLPRT
VQGKPQLSAALQQLIKNAWLDASLQENADAVRSVHLMAALIATPSLLVAEAAWPLLSLSTTQLQRLLPLLDNQSDERPEV
QQAAALADSPVNLTDEAATVTSASGQPQLNDALQAALDKFTLDVTAKARANQIDPIFGRDSEIRQMIDILSRRRKNNPIL
VGEPGVGKTALVEGLALRIADGNVPDSLKTVSVRTLDLGLLQAGAGVKGEFEQRLKNVIEAVQQSPSPVLLFIDEAHTII
GAGNQAGGADAANLLKPALARGELRTIAATTWSEYKQYFERDAALERRFQMVKVDEPDDDTACLMLRGLKERYATHHGVH
ILDAAITAAVTLSRRFLTGRQLPDKAVDLLDTAGARVRMSIDTLPTALMEINAELAALAMEQQAIEQDLLLLPNVSSTRL
PEIEQRRAALAVGQHTLEQQYKEEKRLTTLIIEARQDIANAAHLVALQEELVQIQGNAPLLSLDVDVRTVAAVIADWTGV
PLGSLLKDEQTNLLSLENRLGERVIGQDAALGALAQRLRAAKTGLTSENGPLGVFLLVGPSGIGKTETALALADSLFGGE
KSLITINLSEYQEAHTVSQLKGSPPGYVGYGQGGVLTEAVRKRPYSVVLLDEVEKAHRDVLNLFYQVFDRGFMRDGEGRE
IDFRNTVIVMTANLGSDHLMQLLDEQPDAPDSTLHELLRPILRDHFQPALLARFQTLIYRPLQVDALKRIVAIKLNQVAQ
RLHCHYGLSCQIEDSLTDTLVAACLLPDTGARNIDSLLNQQILPVLSQQLLSRMSEQQRTTSLTLGWHEEDGITLTFEGE

Sequences:

>Translated_880_residues
MTTHSAHLLRRLNPYCAQALAGAATLCQTRAHAEITVEHWLLKLLEQGEGDITVIARRYEWDMDSLWQGLLSHLDTLPRT
VQGKPQLSAALQQLIKNAWLDASLQENADAVRSVHLMAALIATPSLLVAEAAWPLLSLSTTQLQRLLPLLDNQSDERPEV
QQAAALADSPVNLTDEAATVTSASGQPQLNDALQAALDKFTLDVTAKARANQIDPIFGRDSEIRQMIDILSRRRKNNPIL
VGEPGVGKTALVEGLALRIADGNVPDSLKTVSVRTLDLGLLQAGAGVKGEFEQRLKNVIEAVQQSPSPVLLFIDEAHTII
GAGNQAGGADAANLLKPALARGELRTIAATTWSEYKQYFERDAALERRFQMVKVDEPDDDTACLMLRGLKERYATHHGVH
ILDAAITAAVTLSRRFLTGRQLPDKAVDLLDTAGARVRMSIDTLPTALMEINAELAALAMEQQAIEQDLLLLPNVSSTRL
PEIEQRRAALAVGQHTLEQQYKEEKRLTTLIIEARQDIANAAHLVALQEELVQIQGNAPLLSLDVDVRTVAAVIADWTGV
PLGSLLKDEQTNLLSLENRLGERVIGQDAALGALAQRLRAAKTGLTSENGPLGVFLLVGPSGIGKTETALALADSLFGGE
KSLITINLSEYQEAHTVSQLKGSPPGYVGYGQGGVLTEAVRKRPYSVVLLDEVEKAHRDVLNLFYQVFDRGFMRDGEGRE
IDFRNTVIVMTANLGSDHLMQLLDEQPDAPDSTLHELLRPILRDHFQPALLARFQTLIYRPLQVDALKRIVAIKLNQVAQ
RLHCHYGLSCQIEDSLTDTLVAACLLPDTGARNIDSLLNQQILPVLSQQLLSRMSEQQRTTSLTLGWHEEDGITLTFEGE
>Mature_879_residues
TTHSAHLLRRLNPYCAQALAGAATLCQTRAHAEITVEHWLLKLLEQGEGDITVIARRYEWDMDSLWQGLLSHLDTLPRTV
QGKPQLSAALQQLIKNAWLDASLQENADAVRSVHLMAALIATPSLLVAEAAWPLLSLSTTQLQRLLPLLDNQSDERPEVQ
QAAALADSPVNLTDEAATVTSASGQPQLNDALQAALDKFTLDVTAKARANQIDPIFGRDSEIRQMIDILSRRRKNNPILV
GEPGVGKTALVEGLALRIADGNVPDSLKTVSVRTLDLGLLQAGAGVKGEFEQRLKNVIEAVQQSPSPVLLFIDEAHTIIG
AGNQAGGADAANLLKPALARGELRTIAATTWSEYKQYFERDAALERRFQMVKVDEPDDDTACLMLRGLKERYATHHGVHI
LDAAITAAVTLSRRFLTGRQLPDKAVDLLDTAGARVRMSIDTLPTALMEINAELAALAMEQQAIEQDLLLLPNVSSTRLP
EIEQRRAALAVGQHTLEQQYKEEKRLTTLIIEARQDIANAAHLVALQEELVQIQGNAPLLSLDVDVRTVAAVIADWTGVP
LGSLLKDEQTNLLSLENRLGERVIGQDAALGALAQRLRAAKTGLTSENGPLGVFLLVGPSGIGKTETALALADSLFGGEK
SLITINLSEYQEAHTVSQLKGSPPGYVGYGQGGVLTEAVRKRPYSVVLLDEVEKAHRDVLNLFYQVFDRGFMRDGEGREI
DFRNTVIVMTANLGSDHLMQLLDEQPDAPDSTLHELLRPILRDHFQPALLARFQTLIYRPLQVDALKRIVAIKLNQVAQR
LHCHYGLSCQIEDSLTDTLVAACLLPDTGARNIDSLLNQQILPVLSQQLLSRMSEQQRTTSLTLGWHEEDGITLTFEGE

Specific function: Required for secretion of hcp1 probably by providing the energy source for its translocation [H]

COG id: COG0542

COG function: function code O; ATPases with chaperone activity, ATP-binding subunit

Gene ontology:

Cell location: Cytoplasm [H]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the clpA/clpB family [H]

Homologues:

Organism=Homo sapiens, GI13540606, Length=301, Percent_Identity=34.21926910299, Blast_Score=166, Evalue=1e-40,
Organism=Escherichia coli, GI1788943, Length=683, Percent_Identity=43.7774524158126, Blast_Score=553, Evalue=1e-158,
Organism=Escherichia coli, GI1787109, Length=270, Percent_Identity=44.8148148148148, Blast_Score=242, Evalue=9e-65,
Organism=Saccharomyces cerevisiae, GI6320464, Length=739, Percent_Identity=40.0541271989175, Blast_Score=469, Evalue=1e-132,
Organism=Saccharomyces cerevisiae, GI6323002, Length=707, Percent_Identity=37.4823196605375, Blast_Score=440, Evalue=1e-124,

Paralogues:

None

Copy number: 560 Molecules/Cell In: Glucose minimal media [C]

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR003593
- InterPro:   IPR013093
- InterPro:   IPR003959
- InterPro:   IPR017729
- InterPro:   IPR018368
- InterPro:   IPR001270
- InterPro:   IPR019489
- InterPro:   IPR023150 [H]

Pfam domain/function: PF00004 AAA; PF07724 AAA_2; PF10431 ClpB_D2-small [H]

EC number: NA

Molecular weight: Translated: 96251; Mature: 96120

Theoretical pI: Translated: 5.03; Mature: 5.03

Prosite motif: PS00870 CLPAB_1

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.7 %Cys     (Translated Protein)
1.5 %Met     (Translated Protein)
2.2 %Cys+Met (Translated Protein)
0.7 %Cys     (Mature Protein)
1.4 %Met     (Mature Protein)
2.0 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MTTHSAHLLRRLNPYCAQALAGAATLCQTRAHAEITVEHWLLKLLEQGEGDITVIARRYE
CCCHHHHHHHHCCHHHHHHHHHHHHHHHHHCCCEEEHHHHHHHHHHCCCCCEEEEEEECC
WDMDSLWQGLLSHLDTLPRTVQGKPQLSAALQQLIKNAWLDASLQENADAVRSVHLMAAL
CCHHHHHHHHHHHHHHCCHHCCCCCHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHH
IATPSLLVAEAAWPLLSLSTTQLQRLLPLLDNQSDERPEVQQAAALADSPVNLTDEAATV
HHCCHHHHHHHHCHHHHCCHHHHHHHHHHHCCCCCCCHHHHHHHHHCCCCCCCCCCHHEE
TSASGQPQLNDALQAALDKFTLDVTAKARANQIDPIFGRDSEIRQMIDILSRRRKNNPIL
ECCCCCCCHHHHHHHHHHHHEEEEEECCCCCCCCCCCCCCHHHHHHHHHHHHHCCCCCEE
VGEPGVGKTALVEGLALRIADGNVPDSLKTVSVRTLDLGLLQAGAGVKGEFEQRLKNVIE
EECCCCCHHHHHHHHEEEEECCCCCCCHHEEEEEEEHHHHHHCCCCCCHHHHHHHHHHHH
AVQQSPSPVLLFIDEAHTIIGAGNQAGGADAANLLKPALARGELRTIAATTWSEYKQYFE
HHHCCCCCEEEEEECCCEEEECCCCCCCCCHHHHHHHHHHCCCHHHHHHHHHHHHHHHHH
RDAALERRFQMVKVDEPDDDTACLMLRGLKERYATHHGVHILDAAITAAVTLSRRFLTGR
HHHHHHHHHHEEECCCCCCCHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHCCC
QLPDKAVDLLDTAGARVRMSIDTLPTALMEINAELAALAMEQQAIEQDLLLLPNVSSTRL
CCCHHHHHHHHCCCCEEEEEHHHHHHHHHHHHHHHHHHHHHHHHHHHCCEECCCCCCCCC
PEIEQRRAALAVGQHTLEQQYKEEKRLTTLIIEARQDIANAAHLVALQEELVQIQGNAPL
CCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCE
LSLDVDVRTVAAVIADWTGVPLGSLLKDEQTNLLSLENRLGERVIGQDAALGALAQRLRA
EEECCHHHHHHHHHHCCCCCCHHHHHHHHCHHHHHHHHHHHHHHHCCHHHHHHHHHHHHH
AKTGLTSENGPLGVFLLVGPSGIGKTETALALADSLFGGEKSLITINLSEYQEAHTVSQL
HHCCCCCCCCCEEEEEEECCCCCCCHHHHHHHHHHHCCCCCEEEEEEHHHHHHHHHHHHH
KGSPPGYVGYGQGGVLTEAVRKRPYSVVLLDEVEKAHRDVLNLFYQVFDRGFMRDGEGRE
CCCCCCEEECCCCCHHHHHHHCCCCEEEEHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCE
IDFRNTVIVMTANLGSDHLMQLLDEQPDAPDSTLHELLRPILRDHFQPALLARFQTLIYR
EECCCEEEEEEECCCHHHHHHHHHCCCCCCHHHHHHHHHHHHHHCCCHHHHHHHHHHHHC
PLQVDALKRIVAIKLNQVAQRLHCHYGLSCQIEDSLTDTLVAACLLPDTGARNIDSLLNQ
CCHHHHHHHHHHHHHHHHHHHHHHHCCCCEEECHHHHHHHHHHHHCCCCCCCHHHHHHHH
QILPVLSQQLLSRMSEQQRTTSLTLGWHEEDGITLTFEGE
HHHHHHHHHHHHHHHHHHHHCEEEEEEECCCCEEEEECCC
>Mature Secondary Structure 
TTHSAHLLRRLNPYCAQALAGAATLCQTRAHAEITVEHWLLKLLEQGEGDITVIARRYE
CCHHHHHHHHCCHHHHHHHHHHHHHHHHHCCCEEEHHHHHHHHHHCCCCCEEEEEEECC
WDMDSLWQGLLSHLDTLPRTVQGKPQLSAALQQLIKNAWLDASLQENADAVRSVHLMAAL
CCHHHHHHHHHHHHHHCCHHCCCCCHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHH
IATPSLLVAEAAWPLLSLSTTQLQRLLPLLDNQSDERPEVQQAAALADSPVNLTDEAATV
HHCCHHHHHHHHCHHHHCCHHHHHHHHHHHCCCCCCCHHHHHHHHHCCCCCCCCCCHHEE
TSASGQPQLNDALQAALDKFTLDVTAKARANQIDPIFGRDSEIRQMIDILSRRRKNNPIL
ECCCCCCCHHHHHHHHHHHHEEEEEECCCCCCCCCCCCCCHHHHHHHHHHHHHCCCCCEE
VGEPGVGKTALVEGLALRIADGNVPDSLKTVSVRTLDLGLLQAGAGVKGEFEQRLKNVIE
EECCCCCHHHHHHHHEEEEECCCCCCCHHEEEEEEEHHHHHHCCCCCCHHHHHHHHHHHH
AVQQSPSPVLLFIDEAHTIIGAGNQAGGADAANLLKPALARGELRTIAATTWSEYKQYFE
HHHCCCCCEEEEEECCCEEEECCCCCCCCCHHHHHHHHHHCCCHHHHHHHHHHHHHHHHH
RDAALERRFQMVKVDEPDDDTACLMLRGLKERYATHHGVHILDAAITAAVTLSRRFLTGR
HHHHHHHHHHEEECCCCCCCHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHCCC
QLPDKAVDLLDTAGARVRMSIDTLPTALMEINAELAALAMEQQAIEQDLLLLPNVSSTRL
CCCHHHHHHHHCCCCEEEEEHHHHHHHHHHHHHHHHHHHHHHHHHHHCCEECCCCCCCCC
PEIEQRRAALAVGQHTLEQQYKEEKRLTTLIIEARQDIANAAHLVALQEELVQIQGNAPL
CCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCE
LSLDVDVRTVAAVIADWTGVPLGSLLKDEQTNLLSLENRLGERVIGQDAALGALAQRLRA
EEECCHHHHHHHHHHCCCCCCHHHHHHHHCHHHHHHHHHHHHHHHCCHHHHHHHHHHHHH
AKTGLTSENGPLGVFLLVGPSGIGKTETALALADSLFGGEKSLITINLSEYQEAHTVSQL
HHCCCCCCCCCEEEEEEECCCCCCCHHHHHHHHHHHCCCCCEEEEEEHHHHHHHHHHHHH
KGSPPGYVGYGQGGVLTEAVRKRPYSVVLLDEVEKAHRDVLNLFYQVFDRGFMRDGEGRE
CCCCCCEEECCCCCHHHHHHHCCCCEEEEHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCE
IDFRNTVIVMTANLGSDHLMQLLDEQPDAPDSTLHELLRPILRDHFQPALLARFQTLIYR
EECCCEEEEEEECCCHHHHHHHHHCCCCCCHHHHHHHHHHHHHHCCCHHHHHHHHHHHHC
PLQVDALKRIVAIKLNQVAQRLHCHYGLSCQIEDSLTDTLVAACLLPDTGARNIDSLLNQ
CCHHHHHHHHHHHHHHHHHHHHHHHCCCCEEECHHHHHHHHHHHHCCCCCCCHHHHHHHH
QILPVLSQQLLSRMSEQQRTTSLTLGWHEEDGITLTFEGE
HHHHHHHHHHHHHHHHHHHHCEEEEEEECCCCEEEEECCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: Hydrolase; Acting on peptide bonds (Peptidases); Serine endopeptidases [C]

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 10984043 [H]