The gene/protein map for NC_007946 is currently unavailable.
Definition Escherichia coli UTI89 chromosome, complete genome.
Accession NC_007946
Length 5,065,741

Click here to switch to the map view.

The map label for this gene is clpV1 [H]

Identifier: 91212191

GI number: 91212191

Start: 3109182

End: 3111827

Strand: Direct

Name: clpV1 [H]

Synonym: UTI89_C3197

Alternate gene names: 91212191

Gene position: 3109182-3111827 (Clockwise)

Preceding gene: 91212190

Following gene: 91212192

Centisome position: 61.38

GC content: 60.36

Gene sequence:

>2646_bases
ATGACAGGAAATCACCCCGCCGCGCTGCTGCGTCGCCTTAACCCATACTGTGCACGGGCGCTGGACGCTGCCGCCTCACT
GTGTCAGACCCGCGCCCATGCGGAGATAACCATTGAACACTGGCTGCTGAAACTGCTGGAGCAGGGAGAAGGCGATATCA
CGGTGATTGCCCGCCGCTATGAATGGGATATCGACACGCTCTGGCAGTCTCTGCTGGCACATCTGGACACCTTACCCCGC
TCGGTCCGCGAACGTCCGCAGCTTTCTGAACCCCTGACGGCGCTTATCAGGCAGGCGTGGCTGATTGCCTCGCTGGAAGG
CGACGACCCGCAAATCCGCAGTCAGCACCTGCTGATGGCGCTGACAGAAAAATCGATGCTGCCCGCCTGTAATGACCTGT
GGGTATTGCTGAGTCTGAGCCGCGTGCAGCTTGAGCGGCTGCGTCCCCTGCTGGATGCGCAGTCGGATGAATGTCCGGCA
CGTCAGCCACAGGTCACCGAACCGCTGACCTCTGCACTGCCGGAGACGGCAACGGCGGACGCACCGGCAAAAACGCTGAC
GGAGAAACAGGATGACGCCCTGCTGGCGGTGCTTAACCGCTTTACCGAAGACGTGACGGAAAAAGCCCGCAGCGGGCGAA
TCGACCCGGTATTCGGGCGCGACACGGAAATTCGCCAGATGGTCGATATCCTCTCCCGTCGCCGCAAAAACAACCCGATT
CTGGTGGGAGAACCGGGGGTGGGCAAAACCGCGCTGGTGGAAGGGCTGGCGCTGCGTATCACCGAAGGCAACGTGCCGGA
CAGCCTGAAAACGGTGCATATCCGCACACTGGACCTCGGTCTGTTACAGGCTGGCGCGGGCGTTAAAGGTGAATTTGAAC
AGCGGCTGAAAAATGTCATCGATGCAGTGCAGAAATCACCGGAGCCGGTACTGCTGTTTATTGATGAAGCCCATACCATT
ATCGGTGCGGGTAATCAGGCAGGCGGCGCGGATGCGGCGAACCTGCTGAAACCGGCACTGGCAAGGGGCGAACTGCGCAC
CATCGCGGCGACCACGTGGAGCGAATACAAACAGTATTTTGAGCGCGACGCCGCGCTGGAGCGCCGCTTCCAGATGGTTA
AGGTTGACGAGCCGGATGATGACACCGCCTGTCTGATGCTGCGGGGACTGAAGGCTCGCTATGCACAGCACCACGGCGTG
CATATGCTGGACAGCGCCATTCAGACCGCCGTGCGCCTGTCGCGCCGCTATCTGACCGGACGCCAGCTGCCGGACAAGGC
GGTTGATTTGCTGGATACCGCCGGGGCAAGAGTCCGCATGAGCCTTGACACCCTGCCGGAACCGTTGACGCAGCTTCATG
CGCGACTGGCGGCACTGGATATTGAGCGGGAAGCGATTGAGCAGGACAGCGTATTTTATCCCGAAGCCAGCCCGGAGCGG
CTGGCGGAACTGACCGATTTGCGTGATGAGCTACAGGCAGAAGCCGGGCATCTGGAAGCGCAGTATCAGCAGGAAAAGGC
ACTGGCGCAGCAGATTATGACGTTGCGTCAGGAAGGAACAGACAGCACTGAACTGCAACAGCAACTGCGAACGCATCAGG
GCTTTGCACCGCTGCTGGCGCTGGATGTGGACGCCCGCGCCGTCGCTACGGTGGTGGCGGACTGGACCGGCATCCCGCTC
TCATCCCTGCTCAGGGACGAGCAGAGCGATCTGCTCAGTATGGAACAGAGCCTTGAAAACCGCGTGGTCGGGCAACGCCC
GGCGCTCTGCGCCATCGCACAGCGGCTGCGGGCGGCTAAAACCGGCCTCACGCCGGAGAACGGCCCACAGGGGGTATTCC
TGCTGACCGGCCCCAGCGGCACCGGCAAAACCGAAACTGCGCTCACACTGGCCGACACCCTGTTTGGTGGTGAAAAATCC
CTTATCACCATTAATCTTTCGGAATACCAGGAACCGCATACCGTTTCCCAGTTGAAAGGTTCGCCTCCGGGCTATGTCGG
CTACGGTCAGGGCGGCGTACTTACCGAAGCCGTTCGCAAACGCCCTTACAGCGTGGTGCTGCTCGACGAAGTGGAAAAGG
CGCATCGCGACGTGATGAACCTGTTCTATCAGGTGTTCGACCGGGGCTTTATGCGCGACGGCGAAGGGCGGGAAATCGAC
TTCCGCAACACCGTCATTCTGATGACCGCCAATCTGGGCAGCGACCACATCATGCAGCTGCTGGAGGAAAAACCGGACGC
CACGGACGCAGACCTGCATGAACTGCTGTATCCCCTTCTGCGAGACCATTTTCAGCCTGCACTGATGGCGCGTTTTCAGA
CGGTGATTTACCGCCCGCTGGGACAGGAAGCGATGCGCACCATTGTGGAAATGAAACTGGCGCAGGTGGTCCGCCGTCTT
CACCAGCACTACGGACTGGAAACGGAAATCAACGACAGCCTGTATGACCAGCTTACCGCCGCCTGCCTGCTGCCGGACAC
CGGTGCGCGTAATATCGACAGCCTGCTGAACCAGCAAATCCTGCCGGTCTTAAGCCAGCAGTTGCTGGCACAGCAGGCCG
CGCACCGTAAACCAGCCCAACTACGGCTTGGCTGGGATGAGGAGGACGGGATTGTACTGGAGTTCGCTACGGAAGAGATG
CAATAA

Upstream 100 bases:

>100_bases
CTGGTGAAACCTGATGGGCCTGAGTGAGGTAACGGCTATGGGCGGTAGCGTGCCTGAACGCGGATCGCAGGAATACAGAA
CACGATAAGGAAACCCTTCT

Downstream 100 bases:

>100_bases
CGGAGGCTGTCATGGGTATTCAGAATTTCGACCACTCACACCACAAGCTCAAAATTCGCGGCCTGAAAAGCCCGGTGGAC
GTGCTGACTTTTACAGGCCA

Product: ClpB protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 881; Mature: 880

Protein sequence:

>881_residues
MTGNHPAALLRRLNPYCARALDAAASLCQTRAHAEITIEHWLLKLLEQGEGDITVIARRYEWDIDTLWQSLLAHLDTLPR
SVRERPQLSEPLTALIRQAWLIASLEGDDPQIRSQHLLMALTEKSMLPACNDLWVLLSLSRVQLERLRPLLDAQSDECPA
RQPQVTEPLTSALPETATADAPAKTLTEKQDDALLAVLNRFTEDVTEKARSGRIDPVFGRDTEIRQMVDILSRRRKNNPI
LVGEPGVGKTALVEGLALRITEGNVPDSLKTVHIRTLDLGLLQAGAGVKGEFEQRLKNVIDAVQKSPEPVLLFIDEAHTI
IGAGNQAGGADAANLLKPALARGELRTIAATTWSEYKQYFERDAALERRFQMVKVDEPDDDTACLMLRGLKARYAQHHGV
HMLDSAIQTAVRLSRRYLTGRQLPDKAVDLLDTAGARVRMSLDTLPEPLTQLHARLAALDIEREAIEQDSVFYPEASPER
LAELTDLRDELQAEAGHLEAQYQQEKALAQQIMTLRQEGTDSTELQQQLRTHQGFAPLLALDVDARAVATVVADWTGIPL
SSLLRDEQSDLLSMEQSLENRVVGQRPALCAIAQRLRAAKTGLTPENGPQGVFLLTGPSGTGKTETALTLADTLFGGEKS
LITINLSEYQEPHTVSQLKGSPPGYVGYGQGGVLTEAVRKRPYSVVLLDEVEKAHRDVMNLFYQVFDRGFMRDGEGREID
FRNTVILMTANLGSDHIMQLLEEKPDATDADLHELLYPLLRDHFQPALMARFQTVIYRPLGQEAMRTIVEMKLAQVVRRL
HQHYGLETEINDSLYDQLTAACLLPDTGARNIDSLLNQQILPVLSQQLLAQQAAHRKPAQLRLGWDEEDGIVLEFATEEM
Q

Sequences:

>Translated_881_residues
MTGNHPAALLRRLNPYCARALDAAASLCQTRAHAEITIEHWLLKLLEQGEGDITVIARRYEWDIDTLWQSLLAHLDTLPR
SVRERPQLSEPLTALIRQAWLIASLEGDDPQIRSQHLLMALTEKSMLPACNDLWVLLSLSRVQLERLRPLLDAQSDECPA
RQPQVTEPLTSALPETATADAPAKTLTEKQDDALLAVLNRFTEDVTEKARSGRIDPVFGRDTEIRQMVDILSRRRKNNPI
LVGEPGVGKTALVEGLALRITEGNVPDSLKTVHIRTLDLGLLQAGAGVKGEFEQRLKNVIDAVQKSPEPVLLFIDEAHTI
IGAGNQAGGADAANLLKPALARGELRTIAATTWSEYKQYFERDAALERRFQMVKVDEPDDDTACLMLRGLKARYAQHHGV
HMLDSAIQTAVRLSRRYLTGRQLPDKAVDLLDTAGARVRMSLDTLPEPLTQLHARLAALDIEREAIEQDSVFYPEASPER
LAELTDLRDELQAEAGHLEAQYQQEKALAQQIMTLRQEGTDSTELQQQLRTHQGFAPLLALDVDARAVATVVADWTGIPL
SSLLRDEQSDLLSMEQSLENRVVGQRPALCAIAQRLRAAKTGLTPENGPQGVFLLTGPSGTGKTETALTLADTLFGGEKS
LITINLSEYQEPHTVSQLKGSPPGYVGYGQGGVLTEAVRKRPYSVVLLDEVEKAHRDVMNLFYQVFDRGFMRDGEGREID
FRNTVILMTANLGSDHIMQLLEEKPDATDADLHELLYPLLRDHFQPALMARFQTVIYRPLGQEAMRTIVEMKLAQVVRRL
HQHYGLETEINDSLYDQLTAACLLPDTGARNIDSLLNQQILPVLSQQLLAQQAAHRKPAQLRLGWDEEDGIVLEFATEEM
Q
>Mature_880_residues
TGNHPAALLRRLNPYCARALDAAASLCQTRAHAEITIEHWLLKLLEQGEGDITVIARRYEWDIDTLWQSLLAHLDTLPRS
VRERPQLSEPLTALIRQAWLIASLEGDDPQIRSQHLLMALTEKSMLPACNDLWVLLSLSRVQLERLRPLLDAQSDECPAR
QPQVTEPLTSALPETATADAPAKTLTEKQDDALLAVLNRFTEDVTEKARSGRIDPVFGRDTEIRQMVDILSRRRKNNPIL
VGEPGVGKTALVEGLALRITEGNVPDSLKTVHIRTLDLGLLQAGAGVKGEFEQRLKNVIDAVQKSPEPVLLFIDEAHTII
GAGNQAGGADAANLLKPALARGELRTIAATTWSEYKQYFERDAALERRFQMVKVDEPDDDTACLMLRGLKARYAQHHGVH
MLDSAIQTAVRLSRRYLTGRQLPDKAVDLLDTAGARVRMSLDTLPEPLTQLHARLAALDIEREAIEQDSVFYPEASPERL
AELTDLRDELQAEAGHLEAQYQQEKALAQQIMTLRQEGTDSTELQQQLRTHQGFAPLLALDVDARAVATVVADWTGIPLS
SLLRDEQSDLLSMEQSLENRVVGQRPALCAIAQRLRAAKTGLTPENGPQGVFLLTGPSGTGKTETALTLADTLFGGEKSL
ITINLSEYQEPHTVSQLKGSPPGYVGYGQGGVLTEAVRKRPYSVVLLDEVEKAHRDVMNLFYQVFDRGFMRDGEGREIDF
RNTVILMTANLGSDHIMQLLEEKPDATDADLHELLYPLLRDHFQPALMARFQTVIYRPLGQEAMRTIVEMKLAQVVRRLH
QHYGLETEINDSLYDQLTAACLLPDTGARNIDSLLNQQILPVLSQQLLAQQAAHRKPAQLRLGWDEEDGIVLEFATEEMQ

Specific function: Required for secretion of hcp1 probably by providing the energy source for its translocation [H]

COG id: COG0542

COG function: function code O; ATPases with chaperone activity, ATP-binding subunit

Gene ontology:

Cell location: Cytoplasm [H]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the clpA/clpB family [H]

Homologues:

Organism=Homo sapiens, GI13540606, Length=305, Percent_Identity=30.4918032786885, Blast_Score=148, Evalue=2e-35,
Organism=Escherichia coli, GI1788943, Length=699, Percent_Identity=43.7768240343348, Blast_Score=561, Evalue=1e-161,
Organism=Escherichia coli, GI1787109, Length=266, Percent_Identity=44.3609022556391, Blast_Score=241, Evalue=2e-64,
Organism=Saccharomyces cerevisiae, GI6320464, Length=683, Percent_Identity=40.5563689604685, Blast_Score=466, Evalue=1e-132,
Organism=Saccharomyces cerevisiae, GI6323002, Length=706, Percent_Identity=36.1189801699717, Blast_Score=437, Evalue=1e-123,

Paralogues:

None

Copy number: 560 Molecules/Cell In: Glucose minimal media [C]

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR003593
- InterPro:   IPR013093
- InterPro:   IPR003959
- InterPro:   IPR017729
- InterPro:   IPR018368
- InterPro:   IPR001270
- InterPro:   IPR019489
- InterPro:   IPR023150 [H]

Pfam domain/function: PF00004 AAA; PF07724 AAA_2; PF10431 ClpB_D2-small [H]

EC number: NA

Molecular weight: Translated: 98025; Mature: 97894

Theoretical pI: Translated: 4.97; Mature: 4.97

Prosite motif: PS00870 CLPAB_1

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.8 %Cys     (Translated Protein)
2.0 %Met     (Translated Protein)
2.8 %Cys+Met (Translated Protein)
0.8 %Cys     (Mature Protein)
1.9 %Met     (Mature Protein)
2.7 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MTGNHPAALLRRLNPYCARALDAAASLCQTRAHAEITIEHWLLKLLEQGEGDITVIARRY
CCCCCHHHHHHHCCHHHHHHHHHHHHHHHHHCCCEEEHHHHHHHHHHCCCCCEEEEEEEC
EWDIDTLWQSLLAHLDTLPRSVRERPQLSEPLTALIRQAWLIASLEGDDPQIRSQHLLMA
CCCHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHEECCCCCHHHHHHHHHHH
LTEKSMLPACNDLWVLLSLSRVQLERLRPLLDAQSDECPARQPQVTEPLTSALPETATAD
HHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCHHHHHCCCCCCCC
APAKTLTEKQDDALLAVLNRFTEDVTEKARSGRIDPVFGRDTEIRQMVDILSRRRKNNPI
CCHHHHHCCCCHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHCCCCCE
LVGEPGVGKTALVEGLALRITEGNVPDSLKTVHIRTLDLGLLQAGAGVKGEFEQRLKNVI
EEECCCCCHHHHHCCCEEEEECCCCCCCCEEEEEEEEHHHHHHCCCCCCHHHHHHHHHHH
DAVQKSPEPVLLFIDEAHTIIGAGNQAGGADAANLLKPALARGELRTIAATTWSEYKQYF
HHHHCCCCCEEEEEECCCEEEECCCCCCCCHHHHHHHHHHHCCCHHHHHHHHHHHHHHHH
ERDAALERRFQMVKVDEPDDDTACLMLRGLKARYAQHHGVHMLDSAIQTAVRLSRRYLTG
HHHHHHHHHHHEEECCCCCCCHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHCC
RQLPDKAVDLLDTAGARVRMSLDTLPEPLTQLHARLAALDIEREAIEQDSVFYPEASPER
CCCCHHHHHHHHCCCCEEEEEHHHCCHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCHHH
LAELTDLRDELQAEAGHLEAQYQQEKALAQQIMTLRQEGTDSTELQQQLRTHQGFAPLLA
HHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHCCCCCCEE
LDVDARAVATVVADWTGIPLSSLLRDEQSDLLSMEQSLENRVVGQRPALCAIAQRLRAAK
ECCCHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHH
TGLTPENGPQGVFLLTGPSGTGKTETALTLADTLFGGEKSLITINLSEYQEPHTVSQLKG
CCCCCCCCCCEEEEEECCCCCCCCHHHHHHHHHHCCCCCCEEEEEHHHCCCCCHHHHHCC
SPPGYVGYGQGGVLTEAVRKRPYSVVLLDEVEKAHRDVMNLFYQVFDRGFMRDGEGREID
CCCCEECCCCCCHHHHHHHCCCCEEEEHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCEEE
FRNTVILMTANLGSDHIMQLLEEKPDATDADLHELLYPLLRDHFQPALMARFQTVIYRPL
CCCEEEEEEECCCHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHCCHHHHHHHHHHHHCCC
GQEAMRTIVEMKLAQVVRRLHQHYGLETEINDSLYDQLTAACLLPDTGARNIDSLLNQQI
CHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHCCCCCCCHHHHHHHHHH
LPVLSQQLLAQQAAHRKPAQLRLGWDEEDGIVLEFATEEMQ
HHHHHHHHHHHHHHCCCCCEEEECCCCCCCEEEEECCCCCC
>Mature Secondary Structure 
TGNHPAALLRRLNPYCARALDAAASLCQTRAHAEITIEHWLLKLLEQGEGDITVIARRY
CCCCHHHHHHHCCHHHHHHHHHHHHHHHHHCCCEEEHHHHHHHHHHCCCCCEEEEEEEC
EWDIDTLWQSLLAHLDTLPRSVRERPQLSEPLTALIRQAWLIASLEGDDPQIRSQHLLMA
CCCHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHEECCCCCHHHHHHHHHHH
LTEKSMLPACNDLWVLLSLSRVQLERLRPLLDAQSDECPARQPQVTEPLTSALPETATAD
HHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCHHHHHCCCCCCCC
APAKTLTEKQDDALLAVLNRFTEDVTEKARSGRIDPVFGRDTEIRQMVDILSRRRKNNPI
CCHHHHHCCCCHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHCCCCCE
LVGEPGVGKTALVEGLALRITEGNVPDSLKTVHIRTLDLGLLQAGAGVKGEFEQRLKNVI
EEECCCCCHHHHHCCCEEEEECCCCCCCCEEEEEEEEHHHHHHCCCCCCHHHHHHHHHHH
DAVQKSPEPVLLFIDEAHTIIGAGNQAGGADAANLLKPALARGELRTIAATTWSEYKQYF
HHHHCCCCCEEEEEECCCEEEECCCCCCCCHHHHHHHHHHHCCCHHHHHHHHHHHHHHHH
ERDAALERRFQMVKVDEPDDDTACLMLRGLKARYAQHHGVHMLDSAIQTAVRLSRRYLTG
HHHHHHHHHHHEEECCCCCCCHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHCC
RQLPDKAVDLLDTAGARVRMSLDTLPEPLTQLHARLAALDIEREAIEQDSVFYPEASPER
CCCCHHHHHHHHCCCCEEEEEHHHCCHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCHHH
LAELTDLRDELQAEAGHLEAQYQQEKALAQQIMTLRQEGTDSTELQQQLRTHQGFAPLLA
HHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHCCCCCCEE
LDVDARAVATVVADWTGIPLSSLLRDEQSDLLSMEQSLENRVVGQRPALCAIAQRLRAAK
ECCCHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHH
TGLTPENGPQGVFLLTGPSGTGKTETALTLADTLFGGEKSLITINLSEYQEPHTVSQLKG
CCCCCCCCCCEEEEEECCCCCCCCHHHHHHHHHHCCCCCCEEEEEHHHCCCCCHHHHHCC
SPPGYVGYGQGGVLTEAVRKRPYSVVLLDEVEKAHRDVMNLFYQVFDRGFMRDGEGREID
CCCCEECCCCCCHHHHHHHCCCCEEEEHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCEEE
FRNTVILMTANLGSDHIMQLLEEKPDATDADLHELLYPLLRDHFQPALMARFQTVIYRPL
CCCEEEEEEECCCHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHCCHHHHHHHHHHHHCCC
GQEAMRTIVEMKLAQVVRRLHQHYGLETEINDSLYDQLTAACLLPDTGARNIDSLLNQQI
CHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHCCCCCCCHHHHHHHHHH
LPVLSQQLLAQQAAHRKPAQLRLGWDEEDGIVLEFATEEMQ
HHHHHHHHHHHHHHCCCCCEEEECCCCCCCEEEEECCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: Hydrolase; Acting on peptide bonds (Peptidases); Serine endopeptidases [C]

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 10984043 [H]