Definition Clostridium difficile 630 chromosome, complete genome.
Accession NC_009089
Length 4,290,252

Click here to switch to the map view.

The map label for this gene is deoA [H]

Identifier: 126698821

GI number: 126698821

Start: 1422867

End: 1424207

Strand: Direct

Name: deoA [H]

Synonym: CD1225

Alternate gene names: 126698821

Gene position: 1422867-1424207 (Clockwise)

Preceding gene: 126698820

Following gene: 126698822

Centisome position: 33.17

GC content: 31.54

Gene sequence:

>1341_bases
ATGGAGATTTCAATTATGAGAATGTATGATATTATAAAAAAAAAGAGAGATAACCTAGAGCTTAGTAAAAAAGAGATAAA
CTACTTTATAGAAAACTATTCAAAGGGAGATATACCTGACTATCAAGCTTCTGCACTATTAATGTCGATTTACTTAAATA
AGATGAATAAACAGGAAACTGTACATCTTACAGAAGCAATGATGAACTCTGGAGACATGATAAACCTATCTGAGATAGAT
GGAATAAAGGTAGATAAGCATAGTACTGGTGGTGTTGGAGATAAGACTACCATAGCTCTTATACCTTTGGTTGCTTCATG
TGGAGCACCAGTTGCAAAGATGTCAGGTAGAGGTCTTGGTCATACTGGTGGTACTATTGATAAATTGGAGTCTATACCAG
GTTTTTCGACAGAAATGGAGATAAGTAAATTTATTGATTCTGTAAATAAGTCTAAAATAGCAGTTTGTGGTCAAAGTGCA
AAGGTAGCAATTGCAGATAAGAAAATATATGCTCTTAGAGATGTTACAGCAACTGTTGATAATATATCATTGATATCATC
AAGTGTAATGTCTAAAAAGTTAGCTTCAGGAGCTGATGCAATTGTGCTAGATGTAAAAACTGGTGATGGAGCATTTATGA
AGACATTAGAAGAGTCTTTTGAGTTAGCTAAATCTATGGTTGATATAGGTACTGGTATGAATAGAGATACAATAGGGATT
GTAACAGATATGGATGAACCTTTAGGTTTTGCAGTGGGAAACTCTTTAGAAGTTATAGAGGCAATTGAGACATTAAAAGG
AAATGGACCTAAAGACCTTGTTGAGCTATGCGAAGTATTAGGAGCATATATGTTGGTTTTATCAAAGGTAGCACATGATT
TTGAAGATGGTGTTGAAAAAATAAGAGAATCAATAAAATCTGGTACTGCTATACAAAAACTCAAAGAGTTTATAGAGAAT
CAAGGTGGTAATAAAGATGTAGTAGATGATTATTCTTTATTCAAAAAATCAAAGTATAAATATCCAGTTAAATCAACTAA
ATCAGGTTATATAAGTAAAATTAAAGCTGAAGATGTTGGTGTATCGGCTATGATTCTTGGAGCAGGTAGAGAAACTAAAG
ATGATATTTTAGATTTATCAGCAGGGATAATTTTAGAAAAGAAAGTAGGAGATTATGTAAATGAAGGTGAAGTTTTAGCT
TACATGTATTATAATGATGAACAAAAGCTTTCATTGGCAAAGGGAAGATTTATTGATTCCTACTCTATTGTAGATTCAAA
AATAGAAAAAAATAAATTAATATATGGTATTGTAACTAAAGAAGAGATTAAAAAGTTTTAG

Upstream 100 bases:

>100_bases
TATAGAAAGTTATTTCTAATAAAGGACAGTTTTTTTATAATACTATAACATTTGAAAGTGTTTTAAAGTTTAATATTTAT
TTAAATTATTATAGGTTAGA

Downstream 100 bases:

>100_bases
AAAATTTTAGAAAAGTGATTATAAAAGGCCTAACATGTCAAAAATAATGTTAGGTTTTTTATTTTTTGATAAACTATAAA
TTATACCAAAAATATATATT

Product: pyrimidine-nucleoside phosphorylase

Products: NA

Alternate protein names: PYNP [H]

Number of amino acids: Translated: 446; Mature: 446

Protein sequence:

>446_residues
MEISIMRMYDIIKKKRDNLELSKKEINYFIENYSKGDIPDYQASALLMSIYLNKMNKQETVHLTEAMMNSGDMINLSEID
GIKVDKHSTGGVGDKTTIALIPLVASCGAPVAKMSGRGLGHTGGTIDKLESIPGFSTEMEISKFIDSVNKSKIAVCGQSA
KVAIADKKIYALRDVTATVDNISLISSSVMSKKLASGADAIVLDVKTGDGAFMKTLEESFELAKSMVDIGTGMNRDTIGI
VTDMDEPLGFAVGNSLEVIEAIETLKGNGPKDLVELCEVLGAYMLVLSKVAHDFEDGVEKIRESIKSGTAIQKLKEFIEN
QGGNKDVVDDYSLFKKSKYKYPVKSTKSGYISKIKAEDVGVSAMILGAGRETKDDILDLSAGIILEKKVGDYVNEGEVLA
YMYYNDEQKLSLAKGRFIDSYSIVDSKIEKNKLIYGIVTKEEIKKF

Sequences:

>Translated_446_residues
MEISIMRMYDIIKKKRDNLELSKKEINYFIENYSKGDIPDYQASALLMSIYLNKMNKQETVHLTEAMMNSGDMINLSEID
GIKVDKHSTGGVGDKTTIALIPLVASCGAPVAKMSGRGLGHTGGTIDKLESIPGFSTEMEISKFIDSVNKSKIAVCGQSA
KVAIADKKIYALRDVTATVDNISLISSSVMSKKLASGADAIVLDVKTGDGAFMKTLEESFELAKSMVDIGTGMNRDTIGI
VTDMDEPLGFAVGNSLEVIEAIETLKGNGPKDLVELCEVLGAYMLVLSKVAHDFEDGVEKIRESIKSGTAIQKLKEFIEN
QGGNKDVVDDYSLFKKSKYKYPVKSTKSGYISKIKAEDVGVSAMILGAGRETKDDILDLSAGIILEKKVGDYVNEGEVLA
YMYYNDEQKLSLAKGRFIDSYSIVDSKIEKNKLIYGIVTKEEIKKF
>Mature_446_residues
MEISIMRMYDIIKKKRDNLELSKKEINYFIENYSKGDIPDYQASALLMSIYLNKMNKQETVHLTEAMMNSGDMINLSEID
GIKVDKHSTGGVGDKTTIALIPLVASCGAPVAKMSGRGLGHTGGTIDKLESIPGFSTEMEISKFIDSVNKSKIAVCGQSA
KVAIADKKIYALRDVTATVDNISLISSSVMSKKLASGADAIVLDVKTGDGAFMKTLEESFELAKSMVDIGTGMNRDTIGI
VTDMDEPLGFAVGNSLEVIEAIETLKGNGPKDLVELCEVLGAYMLVLSKVAHDFEDGVEKIRESIKSGTAIQKLKEFIEN
QGGNKDVVDDYSLFKKSKYKYPVKSTKSGYISKIKAEDVGVSAMILGAGRETKDDILDLSAGIILEKKVGDYVNEGEVLA
YMYYNDEQKLSLAKGRFIDSYSIVDSKIEKNKLIYGIVTKEEIKKF

Specific function: The Enzymes Which Catalyze The Reversible Phosphorolysis Of Pyrimidine Nucleosides Are Involved In The Degradation Of These Compounds And In Their Utilization As Carbon And Energy Sources, Or In The Rescue Of Pyrimidine Bases For Nucleotide Synthesis. [C

COG id: COG0213

COG function: function code F; Thymidine phosphorylase

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the thymidine/pyrimidine-nucleoside phosphorylase family [H]

Homologues:

Organism=Homo sapiens, GI166158925, Length=431, Percent_Identity=34.338747099768, Blast_Score=248, Evalue=1e-65,
Organism=Homo sapiens, GI4503445, Length=431, Percent_Identity=34.338747099768, Blast_Score=248, Evalue=1e-65,
Organism=Homo sapiens, GI166158922, Length=431, Percent_Identity=34.338747099768, Blast_Score=248, Evalue=1e-65,
Organism=Escherichia coli, GI1790842, Length=406, Percent_Identity=38.6699507389163, Blast_Score=283, Evalue=1e-77,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR000312
- InterPro:   IPR017459
- InterPro:   IPR020072
- InterPro:   IPR013102
- InterPro:   IPR018090
- InterPro:   IPR000053
- InterPro:   IPR017872 [H]

Pfam domain/function: PF02885 Glycos_trans_3N; PF00591 Glycos_transf_3; PF07831 PYNP_C [H]

EC number: =2.4.2.2 [H]

Molecular weight: Translated: 48739; Mature: 48739

Theoretical pI: Translated: 5.19; Mature: 5.19

Prosite motif: PS00647 THYMID_PHOSPHORYLASE

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.7 %Cys     (Translated Protein)
4.0 %Met     (Translated Protein)
4.7 %Cys+Met (Translated Protein)
0.7 %Cys     (Mature Protein)
4.0 %Met     (Mature Protein)
4.7 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MEISIMRMYDIIKKKRDNLELSKKEINYFIENYSKGDIPDYQASALLMSIYLNKMNKQET
CCEEHHHHHHHHHHHHCCCCHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHCCCHHH
VHLTEAMMNSGDMINLSEIDGIKVDKHSTGGVGDKTTIALIPLVASCGAPVAKMSGRGLG
HHHHHHHHCCCCEEEECCCCCEEECCCCCCCCCCCHHHHHHHHHHHCCCCHHHHCCCCCC
HTGGTIDKLESIPGFSTEMEISKFIDSVNKSKIAVCGQSAKVAIADKKIYALRDVTATVD
CCCCCHHHHHCCCCCCCHHHHHHHHHHCCCCEEEEECCCCEEEEECCEEEEHHHHHHHHH
NISLISSSVMSKKLASGADAIVLDVKTGDGAFMKTLEESFELAKSMVDIGTGMNRDTIGI
HHHHHHHHHHHHHHHCCCCEEEEEEECCCCHHHHHHHHHHHHHHHHHHHCCCCCCCCEEE
VTDMDEPLGFAVGNSLEVIEAIETLKGNGPKDLVELCEVLGAYMLVLSKVAHDFEDGVEK
EECCCCCCCCCCCCHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
IRESIKSGTAIQKLKEFIENQGGNKDVVDDYSLFKKSKYKYPVKSTKSGYISKIKAEDVG
HHHHHHCCHHHHHHHHHHHCCCCCCCCCHHHHHHHHCCCCCCCCCCCCCCCEEEECCCCC
VSAMILGAGRETKDDILDLSAGIILEKKVGDYVNEGEVLAYMYYNDEQKLSLAKGRFIDS
CEEEEEECCCCCHHHHHHHHCCEEEEHHHCCCCCCCCEEEEEEECCCCHHHHHCCCCCCC
YSIVDSKIEKNKLIYGIVTKEEIKKF
HHHHHHHHHCCCEEEEEEEHHHHHCC
>Mature Secondary Structure
MEISIMRMYDIIKKKRDNLELSKKEINYFIENYSKGDIPDYQASALLMSIYLNKMNKQET
CCEEHHHHHHHHHHHHCCCCHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHCCCHHH
VHLTEAMMNSGDMINLSEIDGIKVDKHSTGGVGDKTTIALIPLVASCGAPVAKMSGRGLG
HHHHHHHHCCCCEEEECCCCCEEECCCCCCCCCCCHHHHHHHHHHHCCCCHHHHCCCCCC
HTGGTIDKLESIPGFSTEMEISKFIDSVNKSKIAVCGQSAKVAIADKKIYALRDVTATVD
CCCCCHHHHHCCCCCCCHHHHHHHHHHCCCCEEEEECCCCEEEEECCEEEEHHHHHHHHH
NISLISSSVMSKKLASGADAIVLDVKTGDGAFMKTLEESFELAKSMVDIGTGMNRDTIGI
HHHHHHHHHHHHHHHCCCCEEEEEEECCCCHHHHHHHHHHHHHHHHHHHCCCCCCCCEEE
VTDMDEPLGFAVGNSLEVIEAIETLKGNGPKDLVELCEVLGAYMLVLSKVAHDFEDGVEK
EECCCCCCCCCCCCHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
IRESIKSGTAIQKLKEFIENQGGNKDVVDDYSLFKKSKYKYPVKSTKSGYISKIKAEDVG
HHHHHHCCHHHHHHHHHHHCCCCCCCCCHHHHHHHHCCCCCCCCCCCCCCCEEEECCCCC
VSAMILGAGRETKDDILDLSAGIILEKKVGDYVNEGEVLAYMYYNDEQKLSLAKGRFIDS
CEEEEEECCCCCHHHHHHHHCCEEEEHHHCCCCCCCCEEEEEEECCCCHHHHHCCCCCCC
YSIVDSKIEKNKLIYGIVTKEEIKKF
HHHHHHHHHCCCEEEEEEEHHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 8987664; 9817849 [H]