Definition Clostridium difficile 630 chromosome, complete genome.
Accession NC_009089
Length 4,290,252

Click here to switch to the map view.

The map label for this gene is opuCC [H]

Identifier: 126698478

GI number: 126698478

Start: 1084489

End: 1086042

Strand: Direct

Name: opuCC [H]

Synonym: CD0901

Alternate gene names: 126698478

Gene position: 1084489-1086042 (Clockwise)

Preceding gene: 126698477

Following gene: 126698479

Centisome position: 25.28

GC content: 30.31

Gene sequence:

>1554_bases
GTGTTCTTGGCTAATTTTTTTAACTTTATACTATTACAAAAAGATAAGATTATAGAGCTTTTAATACAACATATGAGTCT
AACTGTTACATCTATTTTAATAGCTATAATAGTTGGTGTTCCTCTTGGAATAATTATTTCAAGAATCTCATCTCTTAGAA
AGTTTGTACTTGGATTTGTAAACTTAGTCCAAGCAGTTCCGTCTATGGCACTTTTGGGTCTTCTTGTACCTATACTTGGT
ATAGGAAGTAAACCAGCCATATTTATGGTAGTGGTTTATTCATTACTACCAATTGTAAAAAATACGTATATAGGTATAAC
AAGTATTGACCCAGTAGTATTAGAATCAGCTAAAGGTATTGGTCTTACAAGAAATCAGACATTATTTAAAATACAATTTC
CTTTAGCGCTTCCTATAATAATGGGTGGAGTTAGAATATCTGCAGTTACAGCTGTTGGTTTGATGACTCTTGCAGCATTT
ATAGGTGCTGGTGGTTTAGGATATTTAGTATTTTCAGGGGTTCAAACTGTAAATAATAATATGATTTTAGCAGGGGCAAT
CCCATCATGTATAATTGCACTGTTAGTTGATTATTTATTTAGTAAAATTGAAGTTGCAGTTACTCCAAAAGGATTAAATC
CAAAAGCACCTAAGAAGAATTATATAGCACTTAAAGTAATATCTGTAGTGCTTGTTGTTTCAATGTTGTTCGTTGTTTTT
AGTTCTAGTTTTTCAAGTAAAAAAGATACAATAACTATTGGTTCTAAAGATTATACAGAACAACTTATACTTGGCAATGT
TTATGCTGAATTAGTAGAAAAAAATACGAATCTTAAAGTTAAGAAGAATTTAAATCTAGGTGGTTCATCTGTTGCATTTA
ATGCAATTAAATCTGGTGAGTTAGACATGTATGTTGACTATACAGGTACACTTTTGGTAAATGTAATGAGACATGCTCCG
ATTAAAGATGCTGATGAAGCATATAATGTTGTAAAAGATACTATGGAAAAAGAAAATCAGTTAACTTTACTTGACCCTCT
TGGATTTAATAATACTTACACATTAGCCATGATGCCTGAAACTGCTGAAAAGTATGGAATAAATACTATTTCTGATTTGA
CTAAATATGGTAAAGAATTTACATTCTCACCAACTTTGGAGTTTGAAAATAGAGAAGATGGTCTTGTAGGACTTTCTAGA
GATTATGGTTTAAAATTCAAAGATGTAAAAGCAATGAATGGAAGTTTAAGATATACAGCTTTAGATAATAATGAATCTCA
GGTTATAGATGCATTTTTAACTGATGGTCTTATTAAAAAGTTTAATCTTAAGATATTAGAGGATGATAAAAACTTCTTTG
TACCATATTATGCAGCACCATTAGTGAGAGAAGATACTTTGAAGAAATATCCTGAGTTAGAAAAAGTTATGAATATGCTT
TCAGGAAAAGTAAATGAAGAAACTATGAGAGAACTTAACTATCAAGTGGATGAACTTGGTAAATCACCAGAAGAAGTTGC
TCATTCATTCTTAGTTAAAGAAGGCTTAGTATAA

Upstream 100 bases:

>100_bases
TATATTCCGGTTATTTCTGATGAAAATAAACTGGTAGGGCTTATTACTAGAAGTAGTTTACTTTCTGTTTTAAGTGAACA
ATTCTTAGAAATGGAGGTGA

Downstream 100 bases:

>100_bases
AAAATTAATAGTTTATATCAAAAATTTAAGGGAGTGTCTCAAAATGAGCTTTTTAGTTCATGAGGCACTCTTTTTTATAT
GAAATCAAATATATTTTATC

Product: glycine betaine/carnitine/choline ABC transporter substrate-binding protein

Products: NA

Alternate protein names: Osmoprotectant-binding protein [H]

Number of amino acids: Translated: 517; Mature: 517

Protein sequence:

>517_residues
MFLANFFNFILLQKDKIIELLIQHMSLTVTSILIAIIVGVPLGIIISRISSLRKFVLGFVNLVQAVPSMALLGLLVPILG
IGSKPAIFMVVVYSLLPIVKNTYIGITSIDPVVLESAKGIGLTRNQTLFKIQFPLALPIIMGGVRISAVTAVGLMTLAAF
IGAGGLGYLVFSGVQTVNNNMILAGAIPSCIIALLVDYLFSKIEVAVTPKGLNPKAPKKNYIALKVISVVLVVSMLFVVF
SSSFSSKKDTITIGSKDYTEQLILGNVYAELVEKNTNLKVKKNLNLGGSSVAFNAIKSGELDMYVDYTGTLLVNVMRHAP
IKDADEAYNVVKDTMEKENQLTLLDPLGFNNTYTLAMMPETAEKYGINTISDLTKYGKEFTFSPTLEFENREDGLVGLSR
DYGLKFKDVKAMNGSLRYTALDNNESQVIDAFLTDGLIKKFNLKILEDDKNFFVPYYAAPLVREDTLKKYPELEKVMNML
SGKVNEETMRELNYQVDELGKSPEEVAHSFLVKEGLV

Sequences:

>Translated_517_residues
MFLANFFNFILLQKDKIIELLIQHMSLTVTSILIAIIVGVPLGIIISRISSLRKFVLGFVNLVQAVPSMALLGLLVPILG
IGSKPAIFMVVVYSLLPIVKNTYIGITSIDPVVLESAKGIGLTRNQTLFKIQFPLALPIIMGGVRISAVTAVGLMTLAAF
IGAGGLGYLVFSGVQTVNNNMILAGAIPSCIIALLVDYLFSKIEVAVTPKGLNPKAPKKNYIALKVISVVLVVSMLFVVF
SSSFSSKKDTITIGSKDYTEQLILGNVYAELVEKNTNLKVKKNLNLGGSSVAFNAIKSGELDMYVDYTGTLLVNVMRHAP
IKDADEAYNVVKDTMEKENQLTLLDPLGFNNTYTLAMMPETAEKYGINTISDLTKYGKEFTFSPTLEFENREDGLVGLSR
DYGLKFKDVKAMNGSLRYTALDNNESQVIDAFLTDGLIKKFNLKILEDDKNFFVPYYAAPLVREDTLKKYPELEKVMNML
SGKVNEETMRELNYQVDELGKSPEEVAHSFLVKEGLV
>Mature_517_residues
MFLANFFNFILLQKDKIIELLIQHMSLTVTSILIAIIVGVPLGIIISRISSLRKFVLGFVNLVQAVPSMALLGLLVPILG
IGSKPAIFMVVVYSLLPIVKNTYIGITSIDPVVLESAKGIGLTRNQTLFKIQFPLALPIIMGGVRISAVTAVGLMTLAAF
IGAGGLGYLVFSGVQTVNNNMILAGAIPSCIIALLVDYLFSKIEVAVTPKGLNPKAPKKNYIALKVISVVLVVSMLFVVF
SSSFSSKKDTITIGSKDYTEQLILGNVYAELVEKNTNLKVKKNLNLGGSSVAFNAIKSGELDMYVDYTGTLLVNVMRHAP
IKDADEAYNVVKDTMEKENQLTLLDPLGFNNTYTLAMMPETAEKYGINTISDLTKYGKEFTFSPTLEFENREDGLVGLSR
DYGLKFKDVKAMNGSLRYTALDNNESQVIDAFLTDGLIKKFNLKILEDDKNFFVPYYAAPLVREDTLKKYPELEKVMNML
SGKVNEETMRELNYQVDELGKSPEEVAHSFLVKEGLV

Specific function: Member of a high affinity multicomponent binding- protein-dependent transport system for glycine betaine, carnitine, and choline [H]

COG id: COG1732

COG function: function code M; Periplasmic glycine betaine/choline-binding (lipo)protein of an ABC-type transport system (osmoprotectant binding protein)

Gene ontology:

Cell location: Cell membrane; Lipid-anchor (Probable) [H]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

Organism=Escherichia coli, GI1788451, Length=204, Percent_Identity=36.2745098039216, Blast_Score=133, Evalue=3e-32,
Organism=Escherichia coli, GI1788452, Length=279, Percent_Identity=29.3906810035842, Blast_Score=125, Evalue=7e-30,
Organism=Escherichia coli, GI1788449, Length=198, Percent_Identity=33.3333333333333, Blast_Score=117, Evalue=2e-27,
Organism=Escherichia coli, GI1789033, Length=169, Percent_Identity=30.1775147928994, Blast_Score=99, Evalue=5e-22,
Organism=Escherichia coli, GI1786564, Length=170, Percent_Identity=30.5882352941176, Blast_Score=71, Evalue=2e-13,
Organism=Escherichia coli, GI87081802, Length=143, Percent_Identity=30.7692307692308, Blast_Score=63, Evalue=5e-11,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR007210 [H]

Pfam domain/function: PF04069 OpuAC [H]

EC number: NA

Molecular weight: Translated: 56826; Mature: 56826

Theoretical pI: Translated: 7.55; Mature: 7.55

Prosite motif: PS50928 ABC_TM1

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.2 %Cys     (Translated Protein)
3.3 %Met     (Translated Protein)
3.5 %Cys+Met (Translated Protein)
0.2 %Cys     (Mature Protein)
3.3 %Met     (Mature Protein)
3.5 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MFLANFFNFILLQKDKIIELLIQHMSLTVTSILIAIIVGVPLGIIISRISSLRKFVLGFV
CCHHHHHHHHHHCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
NLVQAVPSMALLGLLVPILGIGSKPAIFMVVVYSLLPIVKNTYIGITSIDPVVLESAKGI
HHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHCCEEEECCCCHHHHHCCCCC
GLTRNQTLFKIQFPLALPIIMGGVRISAVTAVGLMTLAAFIGAGGLGYLVFSGVQTVNNN
CCCCCCEEEEEECCHHHHHHHCCHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHCCC
MILAGAIPSCIIALLVDYLFSKIEVAVTPKGLNPKAPKKNYIALKVISVVLVVSMLFVVF
EEEECCHHHHHHHHHHHHHHHHEEEEEECCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHH
SSSFSSKKDTITIGSKDYTEQLILGNVYAELVEKNTNLKVKKNLNLGGSSVAFNAIKSGE
HCCCCCCCCEEEECCCHHHHHHHHHHHHHHHHHCCCCEEEEECCCCCCCHHEEHHCCCCC
LDMYVDYTGTLLVNVMRHAPIKDADEAYNVVKDTMEKENQLTLLDPLGFNNTYTLAMMPE
EEEEEECHHHHHHHHHHCCCCCCHHHHHHHHHHHHHCCCCEEEECCCCCCCEEEEEECCC
TAEKYGINTISDLTKYGKEFTFSPTLEFENREDGLVGLSRDYGLKFKDVKAMNGSLRYTA
HHHHHCCCHHHHHHHCCCCEECCCCCCCCCCCCCCEEECCCCCCCEEHHHHCCCCEEEEE
LDNNESQVIDAFLTDGLIKKFNLKILEDDKNFFVPYYAAPLVREDTLKKYPELEKVMNML
ECCCHHHHHHHHHHHHHHHHCCCEEEECCCCEEEEEHHCCHHHHHHHHHCHHHHHHHHHH
SGKVNEETMRELNYQVDELGKSPEEVAHSFLVKEGLV
CCCCCHHHHHHHCCCHHHHCCCHHHHHHHHHHHHCCC
>Mature Secondary Structure
MFLANFFNFILLQKDKIIELLIQHMSLTVTSILIAIIVGVPLGIIISRISSLRKFVLGFV
CCHHHHHHHHHHCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
NLVQAVPSMALLGLLVPILGIGSKPAIFMVVVYSLLPIVKNTYIGITSIDPVVLESAKGI
HHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHCCEEEECCCCHHHHHCCCCC
GLTRNQTLFKIQFPLALPIIMGGVRISAVTAVGLMTLAAFIGAGGLGYLVFSGVQTVNNN
CCCCCCEEEEEECCHHHHHHHCCHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHCCC
MILAGAIPSCIIALLVDYLFSKIEVAVTPKGLNPKAPKKNYIALKVISVVLVVSMLFVVF
EEEECCHHHHHHHHHHHHHHHHEEEEEECCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHH
SSSFSSKKDTITIGSKDYTEQLILGNVYAELVEKNTNLKVKKNLNLGGSSVAFNAIKSGE
HCCCCCCCCEEEECCCHHHHHHHHHHHHHHHHHCCCCEEEEECCCCCCCHHEEHHCCCCC
LDMYVDYTGTLLVNVMRHAPIKDADEAYNVVKDTMEKENQLTLLDPLGFNNTYTLAMMPE
EEEEEECHHHHHHHHHHCCCCCCHHHHHHHHHHHHHCCCCEEEECCCCCCCEEEEEECCC
TAEKYGINTISDLTKYGKEFTFSPTLEFENREDGLVGLSRDYGLKFKDVKAMNGSLRYTA
HHHHHCCCHHHHHHHCCCCEECCCCCCCCCCCCCCEEECCCCCCCEEHHHHCCCCEEEEE
LDNNESQVIDAFLTDGLIKKFNLKILEDDKNFFVPYYAAPLVREDTLKKYPELEKVMNML
ECCCHHHHHHHHHHHHHHHHCCCEEEECCCCEEEEEHHCCHHHHHHHHHCHHHHHHHHHH
SGKVNEETMRELNYQVDELGKSPEEVAHSFLVKEGLV
CCCCCHHHHHHHCCCHHHHCCCHHHHHHHHHHHHCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 10216873; 9384377 [H]