Definition Escherichia coli UTI89 chromosome, complete genome.
Accession NC_007946
Length 5,065,741

Click here to switch to the map view.

The map label for this gene is csdA [H]

Identifier: 91212180

GI number: 91212180

Start: 3097806

End: 3099047

Strand: Direct

Name: csdA [H]

Synonym: UTI89_C3183

Alternate gene names: 91212180

Gene position: 3097806-3099047 (Clockwise)

Preceding gene: 91212178

Following gene: 91212181

Centisome position: 61.15

GC content: 55.88

Gene sequence:

>1242_bases
TTGCGTCACGATCGGTGCATCAAGCCGAGGAGTACCATGAACGTTTTTAATCCCGCGCAGTTTCGCGCCCAGTTTCCCGC
GCTACAGGATGCGGGCGTCTATCTCGACAGCGCCGCGACCGCGCTTAAACCTGAAGCCGTGGTTGAAGCTACCCGACAGT
TTTATAGCCTGAGCGCCGGAAACGTCCATCGCAGCCAGTTTGCCGAAGCCCAACGCCTGACCGCGCGTTACGAAGCTGCG
CGGGAAAAAGTGGCACAATTACTGAATGCATCGGATGACAAAAATATCGTCTGGACGCGCGGCACCACTGAATCCATCAA
CATGGTGGCGCAATGCTATGCCCGTCCGCGTCTGCAACCGGGCGATGAAATTATTGTCAGTGTGGCAGAACACCACGCCA
ACCTCGTCCCCTGGCTGATGGTCGCCCAACAAACGGGGGCCAAAGTGGTGAAATTGCCGCTTAATGCGCAGCGACTGCCG
GATGTCGATTTGTTGCCAGAACTGATTACTCCCCGTAGTCGGATTCTGGCGTTGGGCCAGATGTCGAACGTCACTGGCGG
TTGCCCGGATCTGGCGAGAGCGATTACTTTTGCTCATTCAGCCGGGATAGTGGTGATGGTTGATGGTGCTCAGGGGGCGG
TGCATTTCCCCGCGGATGTTCAGCAACTGGATATTGATTTCTATGCTTTTTCAGGTCACAAACTGTATGGTCCGACAGGC
ATCGGCGTGCTGTATGGCAAACCAGAACTGCTGGAAGCGATGTCGCCCTGGCTGGGCGGCGGCAAAATGGTTCACGAAGT
GAGTTTTGACGACTTCACGACTCAATCTGCGCCGTGGAAACTGGAAGCAGGAACGCCAAATGTCGCTGGCGTCATAGGAT
TAAGCGCGGCGCTGGAATGGCTGACAGATTACGATATCAACCAGGCCGAAAGCTGGAGCCGTAGCTTAGCAACGCTTGCA
GAAGAAGCGCTGGCGAAACGTCCAGGCTTTCGTTCATTCCGCTGCCTGGATTCCAGCCTGCTGGCCTTTGATTTTGCGGG
TGTTCATCACAGCGATATGGTGACACTGCTGGCGGAGTACGGTATTGCCCTGCGCGCCGGGCAGCATTGCGCTCAGCCGC
TACTGGCAGAATTAGGCGTAACCGGCACACTGCGCGCCTCATTTGCGCCATATAATACAAAGAGTGATGTGGATGCGCTG
GTGAATGCCGTTGACCGCGCGCTGGAATTATTGGTGGATTAA

Upstream 100 bases:

>100_bases
ATTAACGCCTAACACTATTCAGCATATGTTACTGACGCGGCTTCGCCAGGATATCCAGATAATTCTGATGGTTAGCACTC
TCCTTGTATCAAAGTGAATT

Downstream 100 bases:

>100_bases
TGACAAACCCGCAATTCGCCGGACATCCGTTCGGCACAACCGTAACCGCAGAAACGTTACGCAATACCTTCGCACCGTTG
ACGCAATGGGAAGATAAATA

Product: cysteine sulfinate desulfinase

Products: @ALAN01txt*L-Alanine! [C]

Alternate protein names: CSD [H]

Number of amino acids: Translated: 413; Mature: 413

Protein sequence:

>413_residues
MRHDRCIKPRSTMNVFNPAQFRAQFPALQDAGVYLDSAATALKPEAVVEATRQFYSLSAGNVHRSQFAEAQRLTARYEAA
REKVAQLLNASDDKNIVWTRGTTESINMVAQCYARPRLQPGDEIIVSVAEHHANLVPWLMVAQQTGAKVVKLPLNAQRLP
DVDLLPELITPRSRILALGQMSNVTGGCPDLARAITFAHSAGIVVMVDGAQGAVHFPADVQQLDIDFYAFSGHKLYGPTG
IGVLYGKPELLEAMSPWLGGGKMVHEVSFDDFTTQSAPWKLEAGTPNVAGVIGLSAALEWLTDYDINQAESWSRSLATLA
EEALAKRPGFRSFRCLDSSLLAFDFAGVHHSDMVTLLAEYGIALRAGQHCAQPLLAELGVTGTLRASFAPYNTKSDVDAL
VNAVDRALELLVD

Sequences:

>Translated_413_residues
MRHDRCIKPRSTMNVFNPAQFRAQFPALQDAGVYLDSAATALKPEAVVEATRQFYSLSAGNVHRSQFAEAQRLTARYEAA
REKVAQLLNASDDKNIVWTRGTTESINMVAQCYARPRLQPGDEIIVSVAEHHANLVPWLMVAQQTGAKVVKLPLNAQRLP
DVDLLPELITPRSRILALGQMSNVTGGCPDLARAITFAHSAGIVVMVDGAQGAVHFPADVQQLDIDFYAFSGHKLYGPTG
IGVLYGKPELLEAMSPWLGGGKMVHEVSFDDFTTQSAPWKLEAGTPNVAGVIGLSAALEWLTDYDINQAESWSRSLATLA
EEALAKRPGFRSFRCLDSSLLAFDFAGVHHSDMVTLLAEYGIALRAGQHCAQPLLAELGVTGTLRASFAPYNTKSDVDAL
VNAVDRALELLVD
>Mature_413_residues
MRHDRCIKPRSTMNVFNPAQFRAQFPALQDAGVYLDSAATALKPEAVVEATRQFYSLSAGNVHRSQFAEAQRLTARYEAA
REKVAQLLNASDDKNIVWTRGTTESINMVAQCYARPRLQPGDEIIVSVAEHHANLVPWLMVAQQTGAKVVKLPLNAQRLP
DVDLLPELITPRSRILALGQMSNVTGGCPDLARAITFAHSAGIVVMVDGAQGAVHFPADVQQLDIDFYAFSGHKLYGPTG
IGVLYGKPELLEAMSPWLGGGKMVHEVSFDDFTTQSAPWKLEAGTPNVAGVIGLSAALEWLTDYDINQAESWSRSLATLA
EEALAKRPGFRSFRCLDSSLLAFDFAGVHHSDMVTLLAEYGIALRAGQHCAQPLLAELGVTGTLRASFAPYNTKSDVDAL
VNAVDRALELLVD

Specific function: Catalyzes the removal of elemental sulfur and selenium atoms from L-cysteine, L-cystine, L-selenocysteine, and L- selenocystine to produce L-alanine. L-cysteine sulfinic acid is the best substrate. Functions as a selenium delivery protein in the pathway f

COG id: COG0520

COG function: function code E; Selenocysteine lyase

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the class-V pyridoxal-phosphate-dependent aminotransferase family. Csd subfamily [H]

Homologues:

Organism=Homo sapiens, GI32307132, Length=392, Percent_Identity=26.0204081632653, Blast_Score=90, Evalue=4e-18,
Organism=Homo sapiens, GI156713448, Length=434, Percent_Identity=25.5760368663594, Blast_Score=70, Evalue=3e-12,
Organism=Escherichia coli, GI1789175, Length=401, Percent_Identity=97.7556109725686, Blast_Score=805, Evalue=0.0,
Organism=Escherichia coli, GI1787970, Length=404, Percent_Identity=42.8217821782178, Blast_Score=324, Evalue=8e-90,
Organism=Escherichia coli, GI48994898, Length=215, Percent_Identity=30.6976744186047, Blast_Score=93, Evalue=4e-20,
Organism=Caenorhabditis elegans, GI25143064, Length=213, Percent_Identity=30.5164319248826, Blast_Score=104, Evalue=8e-23,
Organism=Caenorhabditis elegans, GI193211090, Length=358, Percent_Identity=24.8603351955307, Blast_Score=77, Evalue=1e-14,
Organism=Saccharomyces cerevisiae, GI6319831, Length=401, Percent_Identity=27.6807980049875, Blast_Score=105, Evalue=1e-23,
Organism=Drosophila melanogaster, GI20129463, Length=373, Percent_Identity=27.8820375335121, Blast_Score=108, Evalue=6e-24,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR000192
- InterPro:   IPR020578
- InterPro:   IPR022471
- InterPro:   IPR015424
- InterPro:   IPR015421
- InterPro:   IPR015422 [H]

Pfam domain/function: PF00266 Aminotran_5 [H]

EC number: 4.4.1.- [C]

Molecular weight: Translated: 44826; Mature: 44826

Theoretical pI: Translated: 5.96; Mature: 5.96

Prosite motif: PS00595 AA_TRANSFER_CLASS_5

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.2 %Cys     (Translated Protein)
2.2 %Met     (Translated Protein)
3.4 %Cys+Met (Translated Protein)
1.2 %Cys     (Mature Protein)
2.2 %Met     (Mature Protein)
3.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MRHDRCIKPRSTMNVFNPAQFRAQFPALQDAGVYLDSAATALKPEAVVEATRQFYSLSAG
CCCCCCCCCCCCCCCCCCHHHHHHCCCHHCCCEEECCHHHHCCHHHHHHHHHHHHHCCCC
NVHRSQFAEAQRLTARYEAAREKVAQLLNASDDKNIVWTRGTTESINMVAQCYARPRLQP
CCHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCEEEECCCCHHHHHHHHHHHCCCCCC
GDEIIVSVAEHHANLVPWLMVAQQTGAKVVKLPLNAQRLPDVDLLPELITPRSRILALGQ
CHHHHHHHHHHCCCHHHHHHHHHHCCCEEEEECCCCCCCCCHHHHHHHHCCHHHEEEHHC
MSNVTGGCPDLARAITFAHSAGIVVMVDGAQGAVHFPADVQQLDIDFYAFSGHKLYGPTG
CCCCCCCCHHHHHHHHHHCCCCEEEEEECCCCCEECCCCCEEEEEEEEEECCCEEECCCC
IGVLYGKPELLEAMSPWLGGGKMVHEVSFDDFTTQSAPWKLEAGTPNVAGVIGLSAALEW
CEEEECCHHHHHHHCCCCCCCCEEEEECCCCCCCCCCCEEEECCCCCHHHHHHHHHHHHH
LTDYDINQAESWSRSLATLAEEALAKRPGFRSFRCLDSSLLAFDFAGVHHSDMVTLLAEY
HHCCCCCHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHEECCCCHHHHHHHHHHC
GIALRAGQHCAQPLLAELGVTGTLRASFAPYNTKSDVDALVNAVDRALELLVD
CHHHHCCHHHHHHHHHHHCCCEEEEECCCCCCCCHHHHHHHHHHHHHHHHHCC
>Mature Secondary Structure
MRHDRCIKPRSTMNVFNPAQFRAQFPALQDAGVYLDSAATALKPEAVVEATRQFYSLSAG
CCCCCCCCCCCCCCCCCCHHHHHHCCCHHCCCEEECCHHHHCCHHHHHHHHHHHHHCCCC
NVHRSQFAEAQRLTARYEAAREKVAQLLNASDDKNIVWTRGTTESINMVAQCYARPRLQP
CCHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCEEEECCCCHHHHHHHHHHHCCCCCC
GDEIIVSVAEHHANLVPWLMVAQQTGAKVVKLPLNAQRLPDVDLLPELITPRSRILALGQ
CHHHHHHHHHHCCCHHHHHHHHHHCCCEEEEECCCCCCCCCHHHHHHHHCCHHHEEEHHC
MSNVTGGCPDLARAITFAHSAGIVVMVDGAQGAVHFPADVQQLDIDFYAFSGHKLYGPTG
CCCCCCCCHHHHHHHHHHCCCCEEEEEECCCCCEECCCCCEEEEEEEEEECCCEEECCCC
IGVLYGKPELLEAMSPWLGGGKMVHEVSFDDFTTQSAPWKLEAGTPNVAGVIGLSAALEW
CEEEECCHHHHHHHCCCCCCCCEEEEECCCCCCCCCCCEEEECCCCCHHHHHHHHHHHHH
LTDYDINQAESWSRSLATLAEEALAKRPGFRSFRCLDSSLLAFDFAGVHHSDMVTLLAEY
HHCCCCCHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHEECCCCHHHHHHHHHHC
GIALRAGQHCAQPLLAELGVTGTLRASFAPYNTKSDVDALVNAVDRALELLVD
CHHHHCCHHHHHHHHHHHCCCEEEEECCCCCCCCHHHHHHHHHHHHHHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: Pyridoxal phosphate [C]

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: L-cystine; L-selenocystine [C]

Specific reaction: Catalyzes the removal of elemental sulfur and selenium atoms from l-cysteine, l-cystine, l-selenocysteine, and l- selenocystine to produce @ALAN01.txt*l-Alanine! [C]

General reaction: Remove sulfur and selenium atoms [C]

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 9278392; 9278503; 10829016; 10739946 [H]