Definition Mesorhizobium loti MAFF303099 chromosome, complete genome.
Accession NC_002678
Length 7,036,071

Click here to switch to the map view.

The map label for this gene is cbs [H]

Identifier: 13470597

GI number: 13470597

Start: 249603

End: 250637

Strand: Direct

Name: cbs [H]

Synonym: mlr0353

Alternate gene names: 13470597

Gene position: 249603-250637 (Clockwise)

Preceding gene: 13470594

Following gene: 13470598

Centisome position: 3.55

GC content: 61.55

Gene sequence:

>1035_bases
ATGCCCCGTTCTGTGATCGACGCGATCGGCAACACGCCTCTGATCCGCCTTAACAAAGCGTCCGAAGAAACCGGCTGCGA
GATCCTGGGCAAGGCCGAATTCATGAATCCGGGGCAATCAGTCAAGGATCGCGCCGGGCTTTTCATCATCCGCGACGCCG
AACGGCGCGGCCTATTGAAGCCGGGCGGCGTCATCGTCGAGGGAACGGCAGGCAATACGGGCATCGGGCTGACGCTGGTC
GCCAAGGCGCTGGGTTATCGCACGGTCATCGTCATTCCCGATACGCAGAGCCAGGAAAAGAAGGACACGATCCGGCTACT
CGGCGCCGAGCTGATCGAGGTGCCGGCCGTGCCCTACAAGAACCCCAACAATTACGTGAAACTGTCGGGACGGCTGGCCG
AGCAGATGGCGAGGACCGAGTCCAACGGCGCCATCTGGGCCAATCAGTTCGACAATGTCGCCAACCGCGATGGGCATATC
CGCACCACGGCGGAGGAAATCTGGGCACAGACCGGCGGCAAGGTTGACGGTTTCGTCTCGGCGGTGGGTTCAGGCGGCAC
GCTGGCCGGCGTCGCTTTCGGGCTGAAGGCCAAGAGCAAGGATGTGAAAATCGCGCTCGCCGACCCGCTTGGTGCCGCCC
TCTACAGCTTTTACACCAGCGGCGAGTTGAAGTCCGAAGGCAGCTCGATCACCGAAGGCATCGGGCAGGGGCGCATCACC
GCCAATCTAGAAGGGTTCACGCCGGATTTCTCGTTCCAGATCAAGGACGAGGACGCGCTTCCGATCGTCTTCGACCTGAT
CCAGGAAGAGGGCCTGTGCGTCGGCGGCTCGACCGGCATCAACATTGCCGGCGCCATCCGGCTCGCCAGGGAATTAGGCC
CCGGCCACACCATCGTGACCATTCTTTGCGACTACGGCACGCGCTACCAGTCGAAGCTGTTCAATCCGGAATTCCTGCGC
GAGAAGAATCTCCCGGTGCCGGGGTGGATGGAACTGCAGAGCAAGATTTCGGTGCCTTTCGAAAAGGTCGAATGA

Upstream 100 bases:

>100_bases
ACAGCAGTACCCGAAATGCGACTGGACCAGGCAAATTCTTGCCTTGAAACCAAAGCTTCGGGTTTCTAGGGTTTCGGCGC
ACGCACACAAGGAATCCTGA

Downstream 100 bases:

>100_bases
TGGCGCACAAGACGGAAGCGTTGTTTCGCGACGATGCCTATCTCGCCACGGCGGATGCGGCGGTTGCTGCCGTCAATGAT
CGTGGCGGCATCATTTTCGA

Product: cysteine synthase A

Products: NA

Alternate protein names: Beta-thionase; Serine sulfhydrase [H]

Number of amino acids: Translated: 344; Mature: 343

Protein sequence:

>344_residues
MPRSVIDAIGNTPLIRLNKASEETGCEILGKAEFMNPGQSVKDRAGLFIIRDAERRGLLKPGGVIVEGTAGNTGIGLTLV
AKALGYRTVIVIPDTQSQEKKDTIRLLGAELIEVPAVPYKNPNNYVKLSGRLAEQMARTESNGAIWANQFDNVANRDGHI
RTTAEEIWAQTGGKVDGFVSAVGSGGTLAGVAFGLKAKSKDVKIALADPLGAALYSFYTSGELKSEGSSITEGIGQGRIT
ANLEGFTPDFSFQIKDEDALPIVFDLIQEEGLCVGGSTGINIAGAIRLARELGPGHTIVTILCDYGTRYQSKLFNPEFLR
EKNLPVPGWMELQSKISVPFEKVE

Sequences:

>Translated_344_residues
MPRSVIDAIGNTPLIRLNKASEETGCEILGKAEFMNPGQSVKDRAGLFIIRDAERRGLLKPGGVIVEGTAGNTGIGLTLV
AKALGYRTVIVIPDTQSQEKKDTIRLLGAELIEVPAVPYKNPNNYVKLSGRLAEQMARTESNGAIWANQFDNVANRDGHI
RTTAEEIWAQTGGKVDGFVSAVGSGGTLAGVAFGLKAKSKDVKIALADPLGAALYSFYTSGELKSEGSSITEGIGQGRIT
ANLEGFTPDFSFQIKDEDALPIVFDLIQEEGLCVGGSTGINIAGAIRLARELGPGHTIVTILCDYGTRYQSKLFNPEFLR
EKNLPVPGWMELQSKISVPFEKVE
>Mature_343_residues
PRSVIDAIGNTPLIRLNKASEETGCEILGKAEFMNPGQSVKDRAGLFIIRDAERRGLLKPGGVIVEGTAGNTGIGLTLVA
KALGYRTVIVIPDTQSQEKKDTIRLLGAELIEVPAVPYKNPNNYVKLSGRLAEQMARTESNGAIWANQFDNVANRDGHIR
TTAEEIWAQTGGKVDGFVSAVGSGGTLAGVAFGLKAKSKDVKIALADPLGAALYSFYTSGELKSEGSSITEGIGQGRITA
NLEGFTPDFSFQIKDEDALPIVFDLIQEEGLCVGGSTGINIAGAIRLARELGPGHTIVTILCDYGTRYQSKLFNPEFLRE
KNLPVPGWMELQSKISVPFEKVE

Specific function: Two Cysteine Synthase Enzymes Are Found. Both Catalyze The Same Reaction. Cysteine Synthase B Can Also Use Thiosulfate In Place Of Sulfide To Give Cysteine Thiosulfonate As A Product. [C]

COG id: COG0031

COG function: function code E; Cysteine synthase

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the cysteine synthase/cystathionine beta- synthase family [H]

Homologues:

Organism=Homo sapiens, GI295821202, Length=340, Percent_Identity=39.4117647058824, Blast_Score=217, Evalue=1e-56,
Organism=Homo sapiens, GI295821200, Length=340, Percent_Identity=39.4117647058824, Blast_Score=217, Evalue=1e-56,
Organism=Homo sapiens, GI4557415, Length=340, Percent_Identity=39.4117647058824, Blast_Score=217, Evalue=1e-56,
Organism=Homo sapiens, GI11345492, Length=206, Percent_Identity=29.6116504854369, Blast_Score=66, Evalue=4e-11,
Organism=Escherichia coli, GI2367138, Length=310, Percent_Identity=38.0645161290323, Blast_Score=172, Evalue=3e-44,
Organism=Escherichia coli, GI1788754, Length=320, Percent_Identity=37.5, Blast_Score=157, Evalue=1e-39,
Organism=Caenorhabditis elegans, GI17535051, Length=314, Percent_Identity=35.6687898089172, Blast_Score=171, Evalue=5e-43,
Organism=Caenorhabditis elegans, GI17562970, Length=317, Percent_Identity=34.7003154574132, Blast_Score=162, Evalue=3e-40,
Organism=Caenorhabditis elegans, GI32566674, Length=305, Percent_Identity=35.4098360655738, Blast_Score=161, Evalue=5e-40,
Organism=Caenorhabditis elegans, GI17561720, Length=323, Percent_Identity=34.6749226006192, Blast_Score=146, Evalue=1e-35,
Organism=Caenorhabditis elegans, GI115535073, Length=305, Percent_Identity=35.7377049180328, Blast_Score=143, Evalue=1e-34,
Organism=Caenorhabditis elegans, GI17534315, Length=331, Percent_Identity=31.1178247734139, Blast_Score=136, Evalue=1e-32,
Organism=Caenorhabditis elegans, GI25147552, Length=337, Percent_Identity=30.2670623145401, Blast_Score=133, Evalue=1e-31,
Organism=Caenorhabditis elegans, GI32566672, Length=231, Percent_Identity=31.1688311688312, Blast_Score=94, Evalue=9e-20,
Organism=Caenorhabditis elegans, GI71996324, Length=373, Percent_Identity=27.8820375335121, Blast_Score=80, Evalue=1e-15,
Organism=Saccharomyces cerevisiae, GI6321449, Length=336, Percent_Identity=39.2857142857143, Blast_Score=187, Evalue=2e-48,
Organism=Saccharomyces cerevisiae, GI6321594, Length=334, Percent_Identity=31.7365269461078, Blast_Score=160, Evalue=2e-40,
Organism=Drosophila melanogaster, GI24643623, Length=329, Percent_Identity=36.1702127659575, Blast_Score=176, Evalue=2e-44,
Organism=Drosophila melanogaster, GI20129101, Length=329, Percent_Identity=36.1702127659575, Blast_Score=176, Evalue=2e-44,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR013785
- InterPro:   IPR005857
- InterPro:   IPR000644
- InterPro:   IPR001926 [H]

Pfam domain/function: PF00571 CBS; PF00291 PALP [H]

EC number: =4.2.1.22 [H]

Molecular weight: Translated: 36824; Mature: 36693

Theoretical pI: Translated: 5.30; Mature: 5.30

Prosite motif: PS00901 CYS_SYNTHASE

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.9 %Cys     (Translated Protein)
1.2 %Met     (Translated Protein)
2.0 %Cys+Met (Translated Protein)
0.9 %Cys     (Mature Protein)
0.9 %Met     (Mature Protein)
1.7 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MPRSVIDAIGNTPLIRLNKASEETGCEILGKAEFMNPGQSVKDRAGLFIIRDAERRGLLK
CCHHHHHHHCCCCEEEEECCCCCCCCEEEECHHCCCCCCCCHHHCCEEEEEECCCCCCCC
PGGVIVEGTAGNTGIGLTLVAKALGYRTVIVIPDTQSQEKKDTIRLLGAELIEVPAVPYK
CCCEEEECCCCCCCCHHHHHHHHHCCEEEEEECCCCCCHHHHHHHHHHHHHHHCCCCCCC
NPNNYVKLSGRLAEQMARTESNGAIWANQFDNVANRDGHIRTTAEEIWAQTGGKVDGFVS
CCCCEEEECHHHHHHHHHHCCCCCEEECCCCCCCCCCCCEEEHHHHHHHHCCCCCCHHHH
AVGSGGTLAGVAFGLKAKSKDVKIALADPLGAALYSFYTSGELKSEGSSITEGIGQGRIT
CCCCCCCEEHEEEECCCCCCCEEEEEECCHHHHHHHHHCCCCCCCCCCHHHHHCCCCEEE
ANLEGFTPDFSFQIKDEDALPIVFDLIQEEGLCVGGSTGINIAGAIRLARELGPGHTIVT
EEECCCCCCCEEEECCCCCCHHHHHHHHHCCEEECCCCCCCHHHHHHHHHHCCCCCEEEE
ILCDYGTRYQSKLFNPEFLREKNLPVPGWMELQSKISVPFEKVE
EEECCCCHHHHHCCCHHHHHHCCCCCCCHHHHHHHCCCCHHHCC
>Mature Secondary Structure 
PRSVIDAIGNTPLIRLNKASEETGCEILGKAEFMNPGQSVKDRAGLFIIRDAERRGLLK
CHHHHHHHCCCCEEEEECCCCCCCCEEEECHHCCCCCCCCHHHCCEEEEEECCCCCCCC
PGGVIVEGTAGNTGIGLTLVAKALGYRTVIVIPDTQSQEKKDTIRLLGAELIEVPAVPYK
CCCEEEECCCCCCCCHHHHHHHHHCCEEEEEECCCCCCHHHHHHHHHHHHHHHCCCCCCC
NPNNYVKLSGRLAEQMARTESNGAIWANQFDNVANRDGHIRTTAEEIWAQTGGKVDGFVS
CCCCEEEECHHHHHHHHHHCCCCCEEECCCCCCCCCCCCEEEHHHHHHHHCCCCCCHHHH
AVGSGGTLAGVAFGLKAKSKDVKIALADPLGAALYSFYTSGELKSEGSSITEGIGQGRIT
CCCCCCCEEHEEEECCCCCCCEEEEEECCHHHHHHHHHCCCCCCCCCCHHHHHCCCCEEE
ANLEGFTPDFSFQIKDEDALPIVFDLIQEEGLCVGGSTGINIAGAIRLARELGPGHTIVT
EEECCCCCCCEEEECCCCCCHHHHHHHHHCCEEECCCCCCCHHHHHHHHHHCCCCCEEEE
ILCDYGTRYQSKLFNPEFLREKNLPVPGWMELQSKISVPFEKVE
EEECCCCHHHHHCCCHHHHHHCCCCCCCHHHHHHHCCCCHHHCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: 9634230; 12218036 [H]