Definition Burkholderia mallei NCTC 10247 chromosome II, complete genome.
Accession NC_009079
Length 2,352,693

Click here to switch to the map view.

The map label for this gene is clpV1 [H]

Identifier: 126447004

GI number: 126447004

Start: 404348

End: 407002

Strand: Direct

Name: clpV1 [H]

Synonym: BMA10247_A0459

Alternate gene names: 126447004

Gene position: 404348-407002 (Clockwise)

Preceding gene: 126446426

Following gene: 126447176

Centisome position: 17.19

GC content: 70.24

Gene sequence:

>2655_bases
ATGTCCGATATCGGCCGAGTGACCTTGTTTGGAAAACTGAACACTTTTCTCTACGAGACCCTGGAGCAGGCGACCGGCTT
TTGTCGGCTGCGCGGCAATCCCTATGTCGAGCTCGCGCACTGGCTGAACCAGATGCTCCGGCGCCCGGACAGCGACGTGC
ACCGGATCCTGCGCCGCTTCGACATCGACGCGGCGGCGATCGACCGCGGGATCGTTTCGGCGCTCGACCGGCTGCCGCGC
GGCGCGGGTTCCGTGTCCGATCTGTCCGCGCACATCGATGATGCGGTCGAACGCGCATGGGTGTACGCGACGCTCAAGTA
CGACGCGGCGCAGATTCGCGGCGCGGTGCTGCTGCTCGCGCTCGTGAAGACGCCGCAGCTGCGCAACGTGCTGTACGCGA
TCGCGCGGGACTTCGAGCGCATCGTGCCTGACGTGCTTGCCGACGAGCTCGAACGGATCGTCGCAGGCTCGCCGGAGGCG
CCGTCGCCCGCCGCGCGCGCGGCGGCGGGGGCGATCGGCGACGCGGGGGCGGCGCCGTCCGCCGCGCGCGAAGGCTCGGC
GCTCGCGCGCTACGCGATCGATCTGACCGCGCGTGCGCGCGCGGGCGAGATCGATCCGGTGGTCGGCCGCGACGGCGAGA
TTCGGCAGATCGTCGACATCCTGCTGCGCCGCCGGCAGAACAATCCGCTGCTCGTCGGCGAGGCGGGCGTCGGCAAGACC
GCGGTCGCCGAAGGCTTCGCGCTGCGCATCGTCGCGGGCGACGTGCCGCCGCCGCTGCGCGACGTCGAACTGTATCTGCT
CGACATCGGCCTGCTGCAGGCGGGCGCGAGCGTGAAGGGCGAATTCGAGAGCCGCCTGCGCGGCGTGATCGACGAGGCGA
GTTCGAGCGAGCGGCCCGTCATTCTGTTCATCGACGAGGTACACACGCTCGTCGGCGCGGGCGGCGCGGCGGGCACGGGC
GACGCGGCGAACCTGTTGAAGCCCGCGCTCGCGCGCGGCCTGCTGCGCACGATCGGCGCGACGACGTGGTCCGAATACAA
GCAATACATCGAGAAGGACCCGGCGCTCACGCGGCGCTTCCAGCTCGTGCAGGTGCGCGAGCCGGAGGAGGGCGCGGCGC
TGGCGATGCTGCGCGGGCTCGCCGCGAAGCTGGAGGCGCACCATCGCGTGCTCGTGCTCGACGATGCGCTGCAGGCGGCC
GTCACGCTGTCGCATCGCTACATTCCCGCGCGGCAGTTGCCGGACAAGGCGATCAGCCTGCTCGACACCGCGTGCGCGCG
CGTCGCGGTCAGCCAGCACGCGGTGCCCGCGCCGATCGAGGACGTGCGGCGGCGGATCGATAGCCTGCGCGTCGAGCGCG
AGCTGATCGCGCGCGAGTGCGCGCTCGGCGCGGGCGATGCGCAACGGCTCGATGCAATCGATGCATCGATCGCCGGCGAA
CAGACCACGCTCGATGCGCTCGACGCGCGCTGGCAGGCGGAGCGCGACGCGCTCGGCAAGATCGTCGACTGGCGGGCCTC
GCTGCTGGCCGACGATTCTTCGCGCGTGCTCGATGAGGCGGCGCGCGCGGACGTGCAGGCGAAGCTCTCGGCCGCGCTGC
GCGCGCTCGCCGAATTGCAGGGCGAGACGCCGCTCGTGCTGCCCGCGGTCGATACGCACGCGGTGGCCGCCGTGGTGTCC
GACTGGACCGGCATCCCGCTCGGGCGGATGGTGCGCGACGAGATGCAATCGGTGCTGAAGCTCGCCGAGACGCTCGCCGA
GCGCGTGGTCGGCCAGCCGCACGCGGTCGAGCTGATCGCCGAGCGCATTCAGACCGCGCGCGCGCGGCTCGACGATCCGG
CCAAGTCGCACGGCGTGTTCCTGCTGTGCGGGCCGTCCGGCGTCGGCAAGACCGAGACGGCGCTCGCGCTCGCCGAGATG
CTGTACGGCGGCGAGCACAACGCGATCACGATCAACATGAGCGAGTTTCAGGAGGCGCACACCGTATCGACGCTCAAGGG
CGCGCCGCCCGGCTACGTCGGCTACGGACAGGGCGGGGTGCTGACCGAGGCGGTGCGGCGGCGGCCGTACAGTGTCGTGC
TGCTCGACGAAATCGAGAAGGCGCACCGCGACGTGCACGAGATCTTCTTTCAGGTGTTCGACAAGGGCTGGATGGAAGAC
GGCGAGGGGCGCTATATCGACTTTCGCAACACGGTGATCCTCCTCACGTCGAACGTCGGTTCCGAGCGCGTGATGCAGCT
GTGCCGCGATCCGCAGCGCCTGCCCGATGCGCAGACCTTGACCGATGCGCTGCGCGAGGTGTTTCCCGCCGCGTTGTTGG
GACGCCTGACGGTCGTTCCGTACTACCCGCTCACCGACGAGATGCTCGCGCGGATCGTCGCATTGCAGCTCGCGCGCATC
GAGCGGCGCATCGAAGCGCACCACGGCATCGCGTTGCGCTGCGCGGATTCGGCGACCGCGCTGATCGCCGAGCGCTGCCG
GACGATCGAATCCGGCGGCCGCATGGTCGACGCGATTCTCACGCACACGGTGCTGCCGCGCATCAGCCAGGAGATCCTGC
GCGCGACGATCGAGGGGCGCGCGCTGCGGGCGATCGACGTGAGCGCCGAAGACGGCCAGTTCGTTTACCGATTCGAAGAG
GAGGGCGCGACGTGA

Upstream 100 bases:

>100_bases
ACGACGAGCGCATGCGCGCTTCGCGCGCACGATCGGGCGCGGCCGATCAGGCGGCCGCCGCCGGTGCGTTGATCGCCAAC
CTGCCTGAACGGGAACCGCC

Downstream 100 bases:

>100_bases
CCCGCGTGTTCACACTCGACAGCCTGCACGGCGACGACCTGAAGTTCCACCGGCTCTACGGCGAGGAAGCGCTCGGGCGG
ATGTTCGACTTCCGGATCGA

Product: putative ATP-dependent Clp protease, ATP-binding subunit ClpB

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 884; Mature: 883

Protein sequence:

>884_residues
MSDIGRVTLFGKLNTFLYETLEQATGFCRLRGNPYVELAHWLNQMLRRPDSDVHRILRRFDIDAAAIDRGIVSALDRLPR
GAGSVSDLSAHIDDAVERAWVYATLKYDAAQIRGAVLLLALVKTPQLRNVLYAIARDFERIVPDVLADELERIVAGSPEA
PSPAARAAAGAIGDAGAAPSAAREGSALARYAIDLTARARAGEIDPVVGRDGEIRQIVDILLRRRQNNPLLVGEAGVGKT
AVAEGFALRIVAGDVPPPLRDVELYLLDIGLLQAGASVKGEFESRLRGVIDEASSSERPVILFIDEVHTLVGAGGAAGTG
DAANLLKPALARGLLRTIGATTWSEYKQYIEKDPALTRRFQLVQVREPEEGAALAMLRGLAAKLEAHHRVLVLDDALQAA
VTLSHRYIPARQLPDKAISLLDTACARVAVSQHAVPAPIEDVRRRIDSLRVERELIARECALGAGDAQRLDAIDASIAGE
QTTLDALDARWQAERDALGKIVDWRASLLADDSSRVLDEAARADVQAKLSAALRALAELQGETPLVLPAVDTHAVAAVVS
DWTGIPLGRMVRDEMQSVLKLAETLAERVVGQPHAVELIAERIQTARARLDDPAKSHGVFLLCGPSGVGKTETALALAEM
LYGGEHNAITINMSEFQEAHTVSTLKGAPPGYVGYGQGGVLTEAVRRRPYSVVLLDEIEKAHRDVHEIFFQVFDKGWMED
GEGRYIDFRNTVILLTSNVGSERVMQLCRDPQRLPDAQTLTDALREVFPAALLGRLTVVPYYPLTDEMLARIVALQLARI
ERRIEAHHGIALRCADSATALIAERCRTIESGGRMVDAILTHTVLPRISQEILRATIEGRALRAIDVSAEDGQFVYRFEE
EGAT

Sequences:

>Translated_884_residues
MSDIGRVTLFGKLNTFLYETLEQATGFCRLRGNPYVELAHWLNQMLRRPDSDVHRILRRFDIDAAAIDRGIVSALDRLPR
GAGSVSDLSAHIDDAVERAWVYATLKYDAAQIRGAVLLLALVKTPQLRNVLYAIARDFERIVPDVLADELERIVAGSPEA
PSPAARAAAGAIGDAGAAPSAAREGSALARYAIDLTARARAGEIDPVVGRDGEIRQIVDILLRRRQNNPLLVGEAGVGKT
AVAEGFALRIVAGDVPPPLRDVELYLLDIGLLQAGASVKGEFESRLRGVIDEASSSERPVILFIDEVHTLVGAGGAAGTG
DAANLLKPALARGLLRTIGATTWSEYKQYIEKDPALTRRFQLVQVREPEEGAALAMLRGLAAKLEAHHRVLVLDDALQAA
VTLSHRYIPARQLPDKAISLLDTACARVAVSQHAVPAPIEDVRRRIDSLRVERELIARECALGAGDAQRLDAIDASIAGE
QTTLDALDARWQAERDALGKIVDWRASLLADDSSRVLDEAARADVQAKLSAALRALAELQGETPLVLPAVDTHAVAAVVS
DWTGIPLGRMVRDEMQSVLKLAETLAERVVGQPHAVELIAERIQTARARLDDPAKSHGVFLLCGPSGVGKTETALALAEM
LYGGEHNAITINMSEFQEAHTVSTLKGAPPGYVGYGQGGVLTEAVRRRPYSVVLLDEIEKAHRDVHEIFFQVFDKGWMED
GEGRYIDFRNTVILLTSNVGSERVMQLCRDPQRLPDAQTLTDALREVFPAALLGRLTVVPYYPLTDEMLARIVALQLARI
ERRIEAHHGIALRCADSATALIAERCRTIESGGRMVDAILTHTVLPRISQEILRATIEGRALRAIDVSAEDGQFVYRFEE
EGAT
>Mature_883_residues
SDIGRVTLFGKLNTFLYETLEQATGFCRLRGNPYVELAHWLNQMLRRPDSDVHRILRRFDIDAAAIDRGIVSALDRLPRG
AGSVSDLSAHIDDAVERAWVYATLKYDAAQIRGAVLLLALVKTPQLRNVLYAIARDFERIVPDVLADELERIVAGSPEAP
SPAARAAAGAIGDAGAAPSAAREGSALARYAIDLTARARAGEIDPVVGRDGEIRQIVDILLRRRQNNPLLVGEAGVGKTA
VAEGFALRIVAGDVPPPLRDVELYLLDIGLLQAGASVKGEFESRLRGVIDEASSSERPVILFIDEVHTLVGAGGAAGTGD
AANLLKPALARGLLRTIGATTWSEYKQYIEKDPALTRRFQLVQVREPEEGAALAMLRGLAAKLEAHHRVLVLDDALQAAV
TLSHRYIPARQLPDKAISLLDTACARVAVSQHAVPAPIEDVRRRIDSLRVERELIARECALGAGDAQRLDAIDASIAGEQ
TTLDALDARWQAERDALGKIVDWRASLLADDSSRVLDEAARADVQAKLSAALRALAELQGETPLVLPAVDTHAVAAVVSD
WTGIPLGRMVRDEMQSVLKLAETLAERVVGQPHAVELIAERIQTARARLDDPAKSHGVFLLCGPSGVGKTETALALAEML
YGGEHNAITINMSEFQEAHTVSTLKGAPPGYVGYGQGGVLTEAVRRRPYSVVLLDEIEKAHRDVHEIFFQVFDKGWMEDG
EGRYIDFRNTVILLTSNVGSERVMQLCRDPQRLPDAQTLTDALREVFPAALLGRLTVVPYYPLTDEMLARIVALQLARIE
RRIEAHHGIALRCADSATALIAERCRTIESGGRMVDAILTHTVLPRISQEILRATIEGRALRAIDVSAEDGQFVYRFEEE
GAT

Specific function: Required for secretion of hcp1 probably by providing the energy source for its translocation [H]

COG id: COG0542

COG function: function code O; ATPases with chaperone activity, ATP-binding subunit

Gene ontology:

Cell location: Cytoplasm [H]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the clpA/clpB family [H]

Homologues:

Organism=Homo sapiens, GI13540606, Length=263, Percent_Identity=33.0798479087452, Blast_Score=135, Evalue=2e-31,
Organism=Escherichia coli, GI1788943, Length=844, Percent_Identity=39.0995260663507, Blast_Score=548, Evalue=1e-157,
Organism=Escherichia coli, GI1787109, Length=441, Percent_Identity=35.6009070294785, Blast_Score=236, Evalue=4e-63,
Organism=Saccharomyces cerevisiae, GI6320464, Length=707, Percent_Identity=38.4724186704385, Blast_Score=462, Evalue=1e-131,
Organism=Saccharomyces cerevisiae, GI6323002, Length=691, Percent_Identity=35.3111432706223, Blast_Score=428, Evalue=1e-120,

Paralogues:

None

Copy number: 560 Molecules/Cell In: Glucose minimal media [C]

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR003593
- InterPro:   IPR013093
- InterPro:   IPR003959
- InterPro:   IPR017729
- InterPro:   IPR018368
- InterPro:   IPR001270
- InterPro:   IPR019489
- InterPro:   IPR023150 [H]

Pfam domain/function: PF00004 AAA; PF07724 AAA_2; PF10431 ClpB_D2-small [H]

EC number: NA

Molecular weight: Translated: 95996; Mature: 95865

Theoretical pI: Translated: 5.44; Mature: 5.44

Prosite motif: PS00870 CLPAB_1

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.8 %Cys     (Translated Protein)
1.2 %Met     (Translated Protein)
2.0 %Cys+Met (Translated Protein)
0.8 %Cys     (Mature Protein)
1.1 %Met     (Mature Protein)
1.9 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSDIGRVTLFGKLNTFLYETLEQATGFCRLRGNPYVELAHWLNQMLRRPDSDVHRILRRF
CCCCCCEEEEHHHHHHHHHHHHHHCCEEEECCCCHHHHHHHHHHHHHCCCHHHHHHHHHH
DIDAAAIDRGIVSALDRLPRGAGSVSDLSAHIDDAVERAWVYATLKYDAAQIRGAVLLLA
CCCHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHEEEEEEEHHHHHHHHHHHHHH
LVKTPQLRNVLYAIARDFERIVPDVLADELERIVAGSPEAPSPAARAAAGAIGDAGAAPS
HHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHCCCCCCCCCCC
AAREGSALARYAIDLTARARAGEIDPVVGRDGEIRQIVDILLRRRQNNPLLVGEAGVGKT
CHHCCCHHHHHHHHHHHCCCCCCCCCCCCCCCCHHHHHHHHHHHCCCCCEEEECCCCCCH
AVAEGFALRIVAGDVPPPLRDVELYLLDIGLLQAGASVKGEFESRLRGVIDEASSSERPV
HHHCCEEEEEEECCCCCCCHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHCCCCCCCE
ILFIDEVHTLVGAGGAAGTGDAANLLKPALARGLLRTIGATTWSEYKQYIEKDPALTRRF
EEEHHHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHCCHHHHHHE
QLVQVREPEEGAALAMLRGLAAKLEAHHRVLVLDDALQAAVTLSHRYIPARQLPDKAISL
EEEEECCCCCCHHHHHHHHHHHHHHHCCEEEEECHHHHHHHHHHHCCCCHHHCCHHHHHH
LDTACARVAVSQHAVPAPIEDVRRRIDSLRVERELIARECALGAGDAQRLDAIDASIAGE
HHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHCCC
QTTLDALDARWQAERDALGKIVDWRASLLADDSSRVLDEAARADVQAKLSAALRALAELQ
CHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHC
GETPLVLPAVDTHAVAAVVSDWTGIPLGRMVRDEMQSVLKLAETLAERVVGQPHAVELIA
CCCCEEEECCCHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHH
ERIQTARARLDDPAKSHGVFLLCGPSGVGKTETALALAEMLYGGEHNAITINMSEFQEAH
HHHHHHHHHCCCCHHHCCEEEEECCCCCCCHHHHHHHHHHHHCCCCCEEEEEHHHHHHHH
TVSTLKGAPPGYVGYGQGGVLTEAVRRRPYSVVLLDEIEKAHRDVHEIFFQVFDKGWMED
HHHHHCCCCCCCCCCCCCCHHHHHHHCCCCEEEEHHHHHHHHHHHHHHHHHHHHHCCCCC
GEGRYIDFRNTVILLTSNVGSERVMQLCRDPQRLPDAQTLTDALREVFPAALLGRLTVVP
CCCCEEEECCEEEEEECCCCHHHHHHHHCCHHHCCCHHHHHHHHHHHHHHHHHHHHHEEC
YYPLTDEMLARIVALQLARIERRIEAHHGIALRCADSATALIAERCRTIESGGRMVDAIL
CCCCCHHHHHHHHHHHHHHHHHHHHHHCCEEEEECCHHHHHHHHHHHHHHCCCHHHHHHH
THTVLPRISQEILRATIEGRALRAIDVSAEDGQFVYRFEEEGAT
HHHHHHHHHHHHHHHHHCCCEEEEEECCCCCCCEEEEECCCCCC
>Mature Secondary Structure 
SDIGRVTLFGKLNTFLYETLEQATGFCRLRGNPYVELAHWLNQMLRRPDSDVHRILRRF
CCCCCEEEEHHHHHHHHHHHHHHCCEEEECCCCHHHHHHHHHHHHHCCCHHHHHHHHHH
DIDAAAIDRGIVSALDRLPRGAGSVSDLSAHIDDAVERAWVYATLKYDAAQIRGAVLLLA
CCCHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHEEEEEEEHHHHHHHHHHHHHH
LVKTPQLRNVLYAIARDFERIVPDVLADELERIVAGSPEAPSPAARAAAGAIGDAGAAPS
HHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHCCCCCCCCCCC
AAREGSALARYAIDLTARARAGEIDPVVGRDGEIRQIVDILLRRRQNNPLLVGEAGVGKT
CHHCCCHHHHHHHHHHHCCCCCCCCCCCCCCCCHHHHHHHHHHHCCCCCEEEECCCCCCH
AVAEGFALRIVAGDVPPPLRDVELYLLDIGLLQAGASVKGEFESRLRGVIDEASSSERPV
HHHCCEEEEEEECCCCCCCHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHCCCCCCCE
ILFIDEVHTLVGAGGAAGTGDAANLLKPALARGLLRTIGATTWSEYKQYIEKDPALTRRF
EEEHHHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHCCHHHHHHE
QLVQVREPEEGAALAMLRGLAAKLEAHHRVLVLDDALQAAVTLSHRYIPARQLPDKAISL
EEEEECCCCCCHHHHHHHHHHHHHHHCCEEEEECHHHHHHHHHHHCCCCHHHCCHHHHHH
LDTACARVAVSQHAVPAPIEDVRRRIDSLRVERELIARECALGAGDAQRLDAIDASIAGE
HHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHCCC
QTTLDALDARWQAERDALGKIVDWRASLLADDSSRVLDEAARADVQAKLSAALRALAELQ
CHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHC
GETPLVLPAVDTHAVAAVVSDWTGIPLGRMVRDEMQSVLKLAETLAERVVGQPHAVELIA
CCCCEEEECCCHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHH
ERIQTARARLDDPAKSHGVFLLCGPSGVGKTETALALAEMLYGGEHNAITINMSEFQEAH
HHHHHHHHHCCCCHHHCCEEEEECCCCCCCHHHHHHHHHHHHCCCCCEEEEEHHHHHHHH
TVSTLKGAPPGYVGYGQGGVLTEAVRRRPYSVVLLDEIEKAHRDVHEIFFQVFDKGWMED
HHHHHCCCCCCCCCCCCCCHHHHHHHCCCCEEEEHHHHHHHHHHHHHHHHHHHHHCCCCC
GEGRYIDFRNTVILLTSNVGSERVMQLCRDPQRLPDAQTLTDALREVFPAALLGRLTVVP
CCCCEEEECCEEEEEECCCCHHHHHHHHCCHHHCCCHHHHHHHHHHHHHHHHHHHHHEEC
YYPLTDEMLARIVALQLARIERRIEAHHGIALRCADSATALIAERCRTIESGGRMVDAIL
CCCCCHHHHHHHHHHHHHHHHHHHHHHCCEEEEECCHHHHHHHHHHHHHHCCCHHHHHHH
THTVLPRISQEILRATIEGRALRAIDVSAEDGQFVYRFEEEGAT
HHHHHHHHHHHHHHHHHCCCEEEEEECCCCCCCEEEEECCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: Hydrolase; Acting on peptide bonds (Peptidases); Serine endopeptidases [C]

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 10984043 [H]