Definition Clostridium botulinum A str. Hall, complete genome.
Accession NC_009698
Length 3,760,560

Click here to switch to the map view.

The map label for this gene is cysK-2 [H]

Identifier: 153936282

GI number: 153936282

Start: 1262594

End: 1263523

Strand: Direct

Name: cysK-2 [H]

Synonym: CLC_1222

Alternate gene names: 153936282

Gene position: 1262594-1263523 (Clockwise)

Preceding gene: 153935743

Following gene: 153936492

Centisome position: 33.57

GC content: 31.51

Gene sequence:

>930_bases
ATGAAAAAAATATATAAAAATATAACAGAATTAATAGGAAATACACCATTATTAGAATTAGAAAAATTAAAAAAAGAAAA
TAAATTAAAAGCTAATATAATAGCTAAAGTAGAATATTTTAATCCGGCAAACAGTGTAAAAGATAGAATAGCCTTCTCCA
TGATAGAAGAAGCAGAAAAAGAAGGATTAATAGATAAAGACACAGTAATAATAGAACCTACTAGTGGTAATACAGGAGTA
GGACTTGCTTTTGTAGCAGCGGCTAAAGGGTATAAACTTATACTAACTATGCCAGAAACTATGAGTATGGAAAGAAGACT
TATATTAAAAGCCTATGGTGCCGAGTTAGTCTTAACACCGGGAAAGGATGGAATGAAGGGGGCTATAGAAAAAGCAACAG
AATTATCAAAGGAATATAAAAATTCTTTTGTTCCGCAGCAATTTGAAAATAAATTTAATCCAGCTATGCATAAGAGGACT
ACAGCGGTAGAAATTTGGAATGATACAGACGGGGAAGTAGATATATTCATAGCAGGAGTAGGTACAGGTGGAACAATTAC
AGGAGTAGGGGAATATCTAAAAGAAAAAAATAAGGATATAAAAATAATAGCAGTAGAACCAGAAGATTCACCGGTTTTAT
CAGGAGGAAATCCAGGACCACATAAAATTCAAGGAATAGGAGCTGGATTTGTACCAAGTACTTTAAACACAGAGGTTTTA
GATGAAATATTTAAAGTATCTAATGAAAAAGCTTTTGAAGTAACAAAGAGTATAGCAAAAACAGAAGGCCTTTTAGTTGG
TATATCTTCAGGAGCAGCAATTTATGCGGCTATGAAAATAAAAGATATTTATCTACAGGAGTATTTGAGTAATAGAAAAA
TAATTAATGAGGAAACCATAGATAGGAGGAAAAATTGTGGAAATTTTTGA

Upstream 100 bases:

>100_bases
CAGTAGAAATTAAAAATGAAATTTTAATCTAAAACATAGTAAACCAATAGGCAAACTGATACCATCATATAATATTTAGC
ATTTAGAGGAGAGAATAATT

Downstream 100 bases:

>100_bases
TGCAAAATATTTAGTACAATCATTAATAGTTCTTTTAAAGTATGCTCACATAACATTGTCTATAGCCATTTTATCTATGA
TTATAGCTGTTTTATTTGGG

Product: cysteine synthase A

Products: NA

Alternate protein names: OAS sulfhydrylase; OASS; Cysteine synthase A; CSase A; O-acetylserine (thiol)-lyase A; OAS-TL A; O-acetylserine-specific cysteine synthase; Sulfide-dependent cysteine synthase [H]

Number of amino acids: Translated: 309; Mature: 309

Protein sequence:

>309_residues
MKKIYKNITELIGNTPLLELEKLKKENKLKANIIAKVEYFNPANSVKDRIAFSMIEEAEKEGLIDKDTVIIEPTSGNTGV
GLAFVAAAKGYKLILTMPETMSMERRLILKAYGAELVLTPGKDGMKGAIEKATELSKEYKNSFVPQQFENKFNPAMHKRT
TAVEIWNDTDGEVDIFIAGVGTGGTITGVGEYLKEKNKDIKIIAVEPEDSPVLSGGNPGPHKIQGIGAGFVPSTLNTEVL
DEIFKVSNEKAFEVTKSIAKTEGLLVGISSGAAIYAAMKIKDIYLQEYLSNRKIINEETIDRRKNCGNF

Sequences:

>Translated_309_residues
MKKIYKNITELIGNTPLLELEKLKKENKLKANIIAKVEYFNPANSVKDRIAFSMIEEAEKEGLIDKDTVIIEPTSGNTGV
GLAFVAAAKGYKLILTMPETMSMERRLILKAYGAELVLTPGKDGMKGAIEKATELSKEYKNSFVPQQFENKFNPAMHKRT
TAVEIWNDTDGEVDIFIAGVGTGGTITGVGEYLKEKNKDIKIIAVEPEDSPVLSGGNPGPHKIQGIGAGFVPSTLNTEVL
DEIFKVSNEKAFEVTKSIAKTEGLLVGISSGAAIYAAMKIKDIYLQEYLSNRKIINEETIDRRKNCGNF
>Mature_309_residues
MKKIYKNITELIGNTPLLELEKLKKENKLKANIIAKVEYFNPANSVKDRIAFSMIEEAEKEGLIDKDTVIIEPTSGNTGV
GLAFVAAAKGYKLILTMPETMSMERRLILKAYGAELVLTPGKDGMKGAIEKATELSKEYKNSFVPQQFENKFNPAMHKRT
TAVEIWNDTDGEVDIFIAGVGTGGTITGVGEYLKEKNKDIKIIAVEPEDSPVLSGGNPGPHKIQGIGAGFVPSTLNTEVL
DEIFKVSNEKAFEVTKSIAKTEGLLVGISSGAAIYAAMKIKDIYLQEYLSNRKIINEETIDRRKNCGNF

Specific function: Catalyzes the conversion of O-acetylserine (OAS) to cysteine through the elimination of acetate and addition of hydrogen sulfide [H]

COG id: COG0031

COG function: function code E; Cysteine synthase

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the cysteine synthase/cystathionine beta- synthase family [H]

Homologues:

Organism=Homo sapiens, GI295821202, Length=285, Percent_Identity=42.8070175438597, Blast_Score=229, Evalue=2e-60,
Organism=Homo sapiens, GI295821200, Length=285, Percent_Identity=42.8070175438597, Blast_Score=229, Evalue=2e-60,
Organism=Homo sapiens, GI4557415, Length=285, Percent_Identity=42.8070175438597, Blast_Score=229, Evalue=2e-60,
Organism=Homo sapiens, GI11345492, Length=294, Percent_Identity=25.5102040816327, Blast_Score=69, Evalue=5e-12,
Organism=Escherichia coli, GI1788754, Length=304, Percent_Identity=50, Blast_Score=266, Evalue=9e-73,
Organism=Escherichia coli, GI2367138, Length=273, Percent_Identity=39.5604395604396, Blast_Score=211, Evalue=5e-56,
Organism=Escherichia coli, GI1790207, Length=236, Percent_Identity=30.0847457627119, Blast_Score=63, Evalue=2e-11,
Organism=Caenorhabditis elegans, GI17535051, Length=272, Percent_Identity=51.8382352941177, Blast_Score=279, Evalue=2e-75,
Organism=Caenorhabditis elegans, GI32566674, Length=272, Percent_Identity=49.6323529411765, Blast_Score=265, Evalue=3e-71,
Organism=Caenorhabditis elegans, GI17562970, Length=272, Percent_Identity=49.6323529411765, Blast_Score=264, Evalue=4e-71,
Organism=Caenorhabditis elegans, GI115535073, Length=279, Percent_Identity=51.9713261648746, Blast_Score=261, Evalue=3e-70,
Organism=Caenorhabditis elegans, GI17561720, Length=272, Percent_Identity=45.5882352941176, Blast_Score=222, Evalue=2e-58,
Organism=Caenorhabditis elegans, GI32566672, Length=184, Percent_Identity=48.3695652173913, Blast_Score=183, Evalue=8e-47,
Organism=Caenorhabditis elegans, GI17534315, Length=288, Percent_Identity=37.5, Blast_Score=174, Evalue=6e-44,
Organism=Caenorhabditis elegans, GI25147552, Length=286, Percent_Identity=36.3636363636364, Blast_Score=166, Evalue=2e-41,
Organism=Caenorhabditis elegans, GI17561716, Length=90, Percent_Identity=40, Blast_Score=77, Evalue=2e-14,
Organism=Caenorhabditis elegans, GI71996324, Length=315, Percent_Identity=23.1746031746032, Blast_Score=70, Evalue=1e-12,
Organism=Saccharomyces cerevisiae, GI6321594, Length=288, Percent_Identity=41.3194444444444, Blast_Score=209, Evalue=4e-55,
Organism=Saccharomyces cerevisiae, GI6321449, Length=304, Percent_Identity=32.5657894736842, Blast_Score=121, Evalue=1e-28,
Organism=Drosophila melanogaster, GI24643623, Length=286, Percent_Identity=38.8111888111888, Blast_Score=192, Evalue=2e-49,
Organism=Drosophila melanogaster, GI20129101, Length=286, Percent_Identity=38.8111888111888, Blast_Score=192, Evalue=2e-49,

Paralogues:

None

Copy number: 2820 Molecules/Cell In: Growth Phase, Minimal Media (Based on E. coli). 240 Molecules/Cell In: Growth Phase, Minimal Media (Based on E. coli). [C]

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR001216
- InterPro:   IPR005856
- InterPro:   IPR005859
- InterPro:   IPR001926 [H]

Pfam domain/function: PF00291 PALP [H]

EC number: =2.5.1.47 [H]

Molecular weight: Translated: 33911; Mature: 33911

Theoretical pI: Translated: 6.59; Mature: 6.59

Prosite motif: PS00901 CYS_SYNTHASE

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.3 %Cys     (Translated Protein)
2.6 %Met     (Translated Protein)
2.9 %Cys+Met (Translated Protein)
0.3 %Cys     (Mature Protein)
2.6 %Met     (Mature Protein)
2.9 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKKIYKNITELIGNTPLLELEKLKKENKLKANIIAKVEYFNPANSVKDRIAFSMIEEAEK
CHHHHHHHHHHHCCCCCHHHHHHHHHCCCEEEEEEEEEECCCHHHHHHHHHHHHHHHHHH
EGLIDKDTVIIEPTSGNTGVGLAFVAAAKGYKLILTMPETMSMERRLILKAYGAELVLTP
CCCCCCCEEEEEECCCCCCCHHHEEECCCCCEEEEECCHHHHHHHHHHHEECCCEEEEEC
GKDGMKGAIEKATELSKEYKNSFVPQQFENKFNPAMHKRTTAVEIWNDTDGEVDIFIAGV
CCCCHHHHHHHHHHHHHHHHHCCCCHHHHHCCCHHHHCCCEEEEEECCCCCCEEEEEEEE
GTGGTITGVGEYLKEKNKDIKIIAVEPEDSPVLSGGNPGPHKIQGIGAGFVPSTLNTEVL
CCCCCHHHHHHHHHHCCCCEEEEEECCCCCCEECCCCCCCCEEEECCCCCCCCCCCHHHH
DEIFKVSNEKAFEVTKSIAKTEGLLVGISSGAAIYAAMKIKDIYLQEYLSNRKIINEETI
HHHHHCCCCHHHHHHHHHHHHCCEEEEECCCCEEEEEHHHHHHHHHHHHCCCCCCCHHHH
DRRKNCGNF
HHHHCCCCC
>Mature Secondary Structure
MKKIYKNITELIGNTPLLELEKLKKENKLKANIIAKVEYFNPANSVKDRIAFSMIEEAEK
CHHHHHHHHHHHCCCCCHHHHHHHHHCCCEEEEEEEEEECCCHHHHHHHHHHHHHHHHHH
EGLIDKDTVIIEPTSGNTGVGLAFVAAAKGYKLILTMPETMSMERRLILKAYGAELVLTP
CCCCCCCEEEEEECCCCCCCHHHEEECCCCCEEEEECCHHHHHHHHHHHEECCCEEEEEC
GKDGMKGAIEKATELSKEYKNSFVPQQFENKFNPAMHKRTTAVEIWNDTDGEVDIFIAGV
CCCCHHHHHHHHHHHHHHHHHCCCCHHHHHCCCHHHHCCCEEEEEECCCCCCEEEEEEEE
GTGGTITGVGEYLKEKNKDIKIIAVEPEDSPVLSGGNPGPHKIQGIGAGFVPSTLNTEVL
CCCCCHHHHHHHHHHCCCCEEEEEECCCCCCEECCCCCCCCEEEECCCCCCCCCCCHHHH
DEIFKVSNEKAFEVTKSIAKTEGLLVGISSGAAIYAAMKIKDIYLQEYLSNRKIINEETI
HHHHHCCCCHHHHHHHHHHHHCCEEEEECCCCEEEEEHHHHHHHHHHHHCCCCCCCHHHH
DRRKNCGNF
HHHHCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: 12788972 [H]