Definition Escherichia coli HS, complete genome.
Accession NC_009800
Length 4,643,538

Click here to switch to the map view.

The map label for this gene is cpdB [H]

Identifier: 157163688

GI number: 157163688

Start: 4469775

End: 4471718

Strand: Reverse

Name: cpdB [H]

Synonym: EcHS_A4467

Alternate gene names: 157163688

Gene position: 4471718-4469775 (Counterclockwise)

Preceding gene: 157163690

Following gene: 157163686

Centisome position: 96.3

GC content: 49.33

Gene sequence:

>1944_bases
ATGATTAAGTTTAGCGCAACGCTCCTGGCCACGCTGATTGCCGCCAGTGTGAATGCAGCGACGGTCGATCTGCGTATCAT
GGAAACCACTGATCTGCATAGCAACATGATGGATTTCGATTATTACAAAGACACCGCCACGGAAAAGTTCGGACTGGTAC
GCACCGCAAGCCTGATTAACGATGCCCGCAATGAAGTCAAAAATAGCGTGCTGGTGGATAACGGCGACTTGATCCAGGGA
AGTCCGCTGGCCGATTACATGTCGGCGAAAGGATTAAAAGCCGGAGATATTCACCCGGTCTATAAGGCATTAAATACGCT
GGACTATACCGTCGGCACGCTTGGCAACCACGAGTTTAACTACGGTCTGGATTACCTGAAAAATGCGTTGGCAGGAGCGA
AATTCCCTTATGTAAATGCCAACGTCATTGACGCAAAAACCAAACAGCCCATGTTTACACCGTATTTAATTAAAGACACC
GAAGTGGTCGATAAAGACGGAAAAAAACAGACGTTAAAGATTGGCTATATTGGCGTCGTGCCGCCGCAGATTATGGGGTG
GGATAAAGCCAATTTGTCCGGCAAAGTCACCGTTAACGATATAACAGAAACTGTGCGCAAATACGTGCCTGAAATGCGTG
AGAAAGGTGCCGATCTCGTTGTCGTTCTGGCGCATTCCGGGCTGTCTGCCGATCCGTATAAAGTGATGGCGGAAAACTCA
GTTTATTATCTCAGTGAAATTCCGGGTGTTGACGCCATTATGTTTGGCCATGCTCACGCCGTTTTCCCAAGTAAAGATTT
TGCTGATATCGAAGGAGCTGATATCGCGAAAGGCACGCTGAATGGTGTTCCGGCGGTAATGCCAGGCATGTGGGGCGATC
ATCTTGGTGTGGTCGACTTACAACTCAGTAATGACAGCGGTAAATGGCAGGTGACGCAGGCGAAAGCGGAAGCACGACCG
ATTTACGACATCGCTAATAAAAAATCCCTCGCGGCGGAAGACAGCAAGCTGGTAGAAACACTCAAAGCCGATCACGATGC
CACACGCCAGTTCGTCAGCAAGCCAATCGGTAAATCTGCCGACAATATGTATAGCTATCTGGCACTGGTGCAGGACGATC
CGACCGTGCAGGTGGTGAACAACGCGCAAAAAGCGTATGTCGAGCATTACATTCAGAGCGATCCGGATCTGGCAAAACTG
CCAGTGCTTTCAGCTGCCGCACCGTTTAAAGTTGGTGGTCGCAAAAATGACCCGGCAAGCTATGTGGAGGTGGAAAAAGG
CCAGTTGACCTTCCGTAATGCCGCCGATCTTTATCTCTACCCCAATACGCTGATTGTGGTGAAAGCCAGCGGTAAAGAGG
TGAAAGAGTGGCTGGAATGCTCTGCCGGACAGTTTAACCAGATTGATCCTAACAGCACGAAACCACAGTCACTCATTAAC
TGGGATGGTTTCCGCACTTATAACTTTGATGTGATTGATGGTGTGAATTATCAGATTGATGTTACCCAACCCGCCCGTTA
TGACGGCGAGTGCCAGATGATTAATGCCAATGCGGAAAGGATTAAGAACCTGACCTTTAACGGCAAGCCGATTGATCCGA
ACGCCATGTTCCTCGTTGCCACCAATAACTATCGCGCTTACGGCGGCAAATTTGCCGGTACGGGCGACAGCCATATCGCT
TTTGCTTCACCGGATGAGAACCGCTCGGTGCTGGCAGCGTGGATTGCTGATGAGTCGAAACGTGCGGGGGAAATTCACCC
GGCGGCAGATAACAACTGGCGTTTAGCACCGATAGCCGGCGATAAGAAACTGGATATCCGTTTCGAAACTTCCCCGTCAG
ATAAAGCCGCAGCGTTTATTAAAGAGAAAGGGCAATATCCGATGAATAAAGTCGCGACCGATGATATCGGGTTTGCGATT
TATCAGGTGGATTTGAGTAAGTAA

Upstream 100 bases:

>100_bases
ATTTTCAAAGCGTAAAATTGTGGCATTCTTCACTGTTCTATAAGTAAGACGTTTATTCTCCCTTTTCTTTCGTATTCCCG
ATAATAAAAGGATGTCCCTG

Downstream 100 bases:

>100_bases
AACACTTCTTTTTCGGCCTATAAATCATCAACCGCATCCGGCATTTATTGGCGGATGCGATGCTGGCGCATCTTATCCGC
CCTACAAGCCATGCACCGTA

Product: bifunctional 2',3'-cyclic nucleotide 2'-phosphodiesterase/3'-nucleotidase periplasmic precursor protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 647; Mature: 647

Protein sequence:

>647_residues
MIKFSATLLATLIAASVNAATVDLRIMETTDLHSNMMDFDYYKDTATEKFGLVRTASLINDARNEVKNSVLVDNGDLIQG
SPLADYMSAKGLKAGDIHPVYKALNTLDYTVGTLGNHEFNYGLDYLKNALAGAKFPYVNANVIDAKTKQPMFTPYLIKDT
EVVDKDGKKQTLKIGYIGVVPPQIMGWDKANLSGKVTVNDITETVRKYVPEMREKGADLVVVLAHSGLSADPYKVMAENS
VYYLSEIPGVDAIMFGHAHAVFPSKDFADIEGADIAKGTLNGVPAVMPGMWGDHLGVVDLQLSNDSGKWQVTQAKAEARP
IYDIANKKSLAAEDSKLVETLKADHDATRQFVSKPIGKSADNMYSYLALVQDDPTVQVVNNAQKAYVEHYIQSDPDLAKL
PVLSAAAPFKVGGRKNDPASYVEVEKGQLTFRNAADLYLYPNTLIVVKASGKEVKEWLECSAGQFNQIDPNSTKPQSLIN
WDGFRTYNFDVIDGVNYQIDVTQPARYDGECQMINANAERIKNLTFNGKPIDPNAMFLVATNNYRAYGGKFAGTGDSHIA
FASPDENRSVLAAWIADESKRAGEIHPAADNNWRLAPIAGDKKLDIRFETSPSDKAAAFIKEKGQYPMNKVATDDIGFAI
YQVDLSK

Sequences:

>Translated_647_residues
MIKFSATLLATLIAASVNAATVDLRIMETTDLHSNMMDFDYYKDTATEKFGLVRTASLINDARNEVKNSVLVDNGDLIQG
SPLADYMSAKGLKAGDIHPVYKALNTLDYTVGTLGNHEFNYGLDYLKNALAGAKFPYVNANVIDAKTKQPMFTPYLIKDT
EVVDKDGKKQTLKIGYIGVVPPQIMGWDKANLSGKVTVNDITETVRKYVPEMREKGADLVVVLAHSGLSADPYKVMAENS
VYYLSEIPGVDAIMFGHAHAVFPSKDFADIEGADIAKGTLNGVPAVMPGMWGDHLGVVDLQLSNDSGKWQVTQAKAEARP
IYDIANKKSLAAEDSKLVETLKADHDATRQFVSKPIGKSADNMYSYLALVQDDPTVQVVNNAQKAYVEHYIQSDPDLAKL
PVLSAAAPFKVGGRKNDPASYVEVEKGQLTFRNAADLYLYPNTLIVVKASGKEVKEWLECSAGQFNQIDPNSTKPQSLIN
WDGFRTYNFDVIDGVNYQIDVTQPARYDGECQMINANAERIKNLTFNGKPIDPNAMFLVATNNYRAYGGKFAGTGDSHIA
FASPDENRSVLAAWIADESKRAGEIHPAADNNWRLAPIAGDKKLDIRFETSPSDKAAAFIKEKGQYPMNKVATDDIGFAI
YQVDLSK
>Mature_647_residues
MIKFSATLLATLIAASVNAATVDLRIMETTDLHSNMMDFDYYKDTATEKFGLVRTASLINDARNEVKNSVLVDNGDLIQG
SPLADYMSAKGLKAGDIHPVYKALNTLDYTVGTLGNHEFNYGLDYLKNALAGAKFPYVNANVIDAKTKQPMFTPYLIKDT
EVVDKDGKKQTLKIGYIGVVPPQIMGWDKANLSGKVTVNDITETVRKYVPEMREKGADLVVVLAHSGLSADPYKVMAENS
VYYLSEIPGVDAIMFGHAHAVFPSKDFADIEGADIAKGTLNGVPAVMPGMWGDHLGVVDLQLSNDSGKWQVTQAKAEARP
IYDIANKKSLAAEDSKLVETLKADHDATRQFVSKPIGKSADNMYSYLALVQDDPTVQVVNNAQKAYVEHYIQSDPDLAKL
PVLSAAAPFKVGGRKNDPASYVEVEKGQLTFRNAADLYLYPNTLIVVKASGKEVKEWLECSAGQFNQIDPNSTKPQSLIN
WDGFRTYNFDVIDGVNYQIDVTQPARYDGECQMINANAERIKNLTFNGKPIDPNAMFLVATNNYRAYGGKFAGTGDSHIA
FASPDENRSVLAAWIADESKRAGEIHPAADNNWRLAPIAGDKKLDIRFETSPSDKAAAFIKEKGQYPMNKVATDDIGFAI
YQVDLSK

Specific function: This bifunctional enzyme catalyzes two consecutive reactions during ribonucleic acid degradation. Converts a 2',3'- cyclic nucleotide to a 3'-nucleotide and then the 3'-nucleotide to the corresponding nucleoside and phosphate [H]

COG id: COG0737

COG function: function code F; 5'-nucleotidase/2',3'-cyclic phosphodiesterase and related esterases

Gene ontology:

Cell location: Periplasm [H]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the 5'-nucleotidase family [H]

Homologues:

Organism=Escherichia coli, GI1790658, Length=647, Percent_Identity=99.2272024729521, Blast_Score=1320, Evalue=0.0,
Organism=Escherichia coli, GI1786687, Length=570, Percent_Identity=21.2280701754386, Blast_Score=88, Evalue=2e-18,

Paralogues:

None

Copy number: 100 Molecules/Cell In: Stationary Phase, Rich Media (Based on E. coli). [C]

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR008334
- InterPro:   IPR006146
- InterPro:   IPR006179
- InterPro:   IPR006294
- InterPro:   IPR004843 [H]

Pfam domain/function: PF02872 5_nucleotid_C; PF00149 Metallophos [H]

EC number: =3.1.3.6; =3.1.4.16 [H]

Molecular weight: Translated: 70880; Mature: 70880

Theoretical pI: Translated: 5.31; Mature: 5.31

Prosite motif: PS00785 5_NUCLEOTIDASE_1 ; PS00786 5_NUCLEOTIDASE_2

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.3 %Cys     (Translated Protein)
2.5 %Met     (Translated Protein)
2.8 %Cys+Met (Translated Protein)
0.3 %Cys     (Mature Protein)
2.5 %Met     (Mature Protein)
2.8 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MIKFSATLLATLIAASVNAATVDLRIMETTDLHSNMMDFDYYKDTATEKFGLVRTASLIN
CEEEHHHHHHHHHHHCCCEEEEEEEEEEECCCCCCCCCCHHHHCCCHHHHHHHHHHHHHH
DARNEVKNSVLVDNGDLIQGSPLADYMSAKGLKAGDIHPVYKALNTLDYTVGTLGNHEFN
HHHHHHCCCEEECCCCEECCCCHHHHHHCCCCCCCCCCHHHHHHHHHHHEEECCCCCCCC
YGLDYLKNALAGAKFPYVNANVIDAKTKQPMFTPYLIKDTEVVDKDGKKQTLKIGYIGVV
CCHHHHHHHHCCCCCCEECCEEEECCCCCCCCCEEEEECCCEECCCCCCEEEEEEEEECC
PPQIMGWDKANLSGKVTVNDITETVRKYVPEMREKGADLVVVLAHSGLSADPYKVMAENS
CHHHCCCCCCCCCCEEEEHHHHHHHHHHHHHHHHCCCCEEEEEECCCCCCCCEEEEECCC
VYYLSEIPGVDAIMFGHAHAVFPSKDFADIEGADIAKGTLNGVPAVMPGMWGDHLGVVDL
EEEEECCCCCCEEEECCEEEECCCCCCCCCCCCCCCCCCCCCCCHHCCCCCCCCCEEEEE
QLSNDSGKWQVTQAKAEARPIYDIANKKSLAAEDSKLVETLKADHDATRQFVSKPIGKSA
EECCCCCCEEEEECCCCCCCCHHHCCCCCCCCCHHHHHHHHHCCHHHHHHHHHCCCCCCH
DNMYSYLALVQDDPTVQVVNNAQKAYVEHYIQSDPDLAKLPVLSAAAPFKVGGRKNDPAS
HHHEEEEEEECCCCCEEEECCHHHHHHHHHHCCCCCHHHCCEECCCCCEECCCCCCCCCC
YVEVEKGQLTFRNAADLYLYPNTLIVVKASGKEVKEWLECSAGQFNQIDPNSTKPQSLIN
EEEEECCEEEEECCCEEEECCCEEEEEECCCHHHHHHHHCCCCCCCCCCCCCCCCCHHCC
WDGFRTYNFDVIDGVNYQIDVTQPARYDGECQMINANAERIKNLTFNGKPIDPNAMFLVA
CCCEEEEEEEEECCCCEEEEECCCCCCCCCEEEEECCHHHHHCCCCCCCCCCCCCEEEEE
TNNYRAYGGKFAGTGDSHIAFASPDENRSVLAAWIADESKRAGEIHPAADNNWRLAPIAG
ECCEEECCCEECCCCCCEEEEECCCCCCEEEEEEECCCCCCCCCCCCCCCCCEEEEEECC
DKKLDIRFETSPSDKAAAFIKEKGQYPMNKVATDDIGFAIYQVDLSK
CCEEEEEEECCCCHHHHHHHHHCCCCCCHHCCCCCCCEEEEEEEECC
>Mature Secondary Structure
MIKFSATLLATLIAASVNAATVDLRIMETTDLHSNMMDFDYYKDTATEKFGLVRTASLIN
CEEEHHHHHHHHHHHCCCEEEEEEEEEEECCCCCCCCCCHHHHCCCHHHHHHHHHHHHHH
DARNEVKNSVLVDNGDLIQGSPLADYMSAKGLKAGDIHPVYKALNTLDYTVGTLGNHEFN
HHHHHHCCCEEECCCCEECCCCHHHHHHCCCCCCCCCCHHHHHHHHHHHEEECCCCCCCC
YGLDYLKNALAGAKFPYVNANVIDAKTKQPMFTPYLIKDTEVVDKDGKKQTLKIGYIGVV
CCHHHHHHHHCCCCCCEECCEEEECCCCCCCCCEEEEECCCEECCCCCCEEEEEEEEECC
PPQIMGWDKANLSGKVTVNDITETVRKYVPEMREKGADLVVVLAHSGLSADPYKVMAENS
CHHHCCCCCCCCCCEEEEHHHHHHHHHHHHHHHHCCCCEEEEEECCCCCCCCEEEEECCC
VYYLSEIPGVDAIMFGHAHAVFPSKDFADIEGADIAKGTLNGVPAVMPGMWGDHLGVVDL
EEEEECCCCCCEEEECCEEEECCCCCCCCCCCCCCCCCCCCCCCHHCCCCCCCCCEEEEE
QLSNDSGKWQVTQAKAEARPIYDIANKKSLAAEDSKLVETLKADHDATRQFVSKPIGKSA
EECCCCCCEEEEECCCCCCCCHHHCCCCCCCCCHHHHHHHHHCCHHHHHHHHHCCCCCCH
DNMYSYLALVQDDPTVQVVNNAQKAYVEHYIQSDPDLAKLPVLSAAAPFKVGGRKNDPAS
HHHEEEEEEECCCCCEEEECCHHHHHHHHHHCCCCCHHHCCEECCCCCEECCCCCCCCCC
YVEVEKGQLTFRNAADLYLYPNTLIVVKASGKEVKEWLECSAGQFNQIDPNSTKPQSLIN
EEEEECCEEEEECCCEEEECCCEEEEEECCCHHHHHHHHCCCCCCCCCCCCCCCCCHHCC
WDGFRTYNFDVIDGVNYQIDVTQPARYDGECQMINANAERIKNLTFNGKPIDPNAMFLVA
CCCEEEEEEEEECCCCEEEEECCCCCCCCCEEEEECCHHHHHCCCCCCCCCCCCCEEEEE
TNNYRAYGGKFAGTGDSHIAFASPDENRSVLAAWIADESKRAGEIHPAADNNWRLAPIAG
ECCEEECCCEECCCCCCEEEEECCCCCCEEEEEEECCCCCCCCCCCCCCCCCEEEEEECC
DKKLDIRFETSPSDKAAAFIKEKGQYPMNKVATDDIGFAIYQVDLSK
CCEEEEEEECCCCHHHHHHHHHCCCCCCHHCCCCCCCEEEEEEEECC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 3005231; 7610040; 9278503; 2172762; 9298646 [H]