| Definition | Clostridium botulinum A str. ATCC 3502, complete genome. |
|---|---|
| Accession | NC_009495 |
| Length | 3,886,916 |
Click here to switch to the map view.
The map label for this gene is csd [H]
Identifier: 148378365
GI number: 148378365
Start: 420582
End: 421904
Strand: Reverse
Name: csd [H]
Synonym: CBO0362
Alternate gene names: 148378365
Gene position: 421904-420582 (Counterclockwise)
Preceding gene: 148378378
Following gene: 148378361
Centisome position: 10.85
GC content: 31.67
Gene sequence:
>1323_bases ATGTATTCTAACAAAAGATCTCCTTATAGATATTTAGTTGTTGGTAGTGACACTAAAGTACCTCTATATAATGGACAACT AACTCCTTGTATAAATTTTGATAATGCAGCTACTACACCACCTTTAGCTTCTGTAATGAATGCTATTGTCAATTTTTCTC CTTGGTATTCCTCCATTCACAGAGGCACTGGATATAAATCTCAATTATCTTCTAAAATTTATGAAGATTCTAGGAAAACA GTTGGCAAGTTTATTGGAGCTGATTTAGATAAAGATGTCATTATATATGTAAAAAATACTACAGAAGCTATTAATAAACT TTCTTATAGGCTTTGTTCCTGTGATGATGATTCTATAATTTTAACAACCTCTATGGAACATCATTCTAACGATTTACCTT GGAGAGATAAATATAATGTAGATTATATAGAGGTAGATGACTGTGGAAGATTGGTAATGGAAGATTTAAGAAGCAAATTA ATAAGGTATGGTGATAAGGTTAAATTAGTTACTATTGCTGGGGCATCTAATGTAACAGGATATATAAATCCTATTTATGA TATAGCAAAATTAGTTCATGAATTTGGATGCAAAATTTTAGTAGATGGAGCACAACTTGTACCACATTGTAAACTCAGCA TGAAACCCCATGACAGTTTAGAACACATTGATTATTTAGCTTTTTCTGCGCATAAAATGTATGCACCCTTTGGTATAGGG GTTTTAATAGGACCTAAAGAAACCTTTGAGAGAGGGGATCCAGATTATAAGGGTGGAGGTACTGTAAATGTAGTAACTAA AGACTATGTACTATGGACAGATCCTCCTGAAAAAGATGAAGCAGGTACCCCAAACGTTATGGGTGTTATAGCTCTTGCCA AAGCTATAGATACCATGACAGGCATAGGAATGAAAAATATTGAAATTTATGAACAAGATATTTTCGAATATGCTTTTAGA AAAATTGCACAGATACCAGATATAAAAATTTATTCTTGCAAAAATCTAGATTACCCTAGAGTTGCTATAATACCTTTTAA TATAAGTGGTATGCACCATAGCATAACTGCAGAAATACTTTCTAAAGAGTTTGGTATAGCTGTGAGAAATGGCTGTTTTT GTGCTCAACCGTATGTTCAAAAAATATTAAACATTCCAAAAGAAGAGATAGGGTCATATGCAAATGAGCCTATGAATAAA AGACCAGGTATGGTTAGATTAAGCTTTGGTATGTATAATGACATTTACGAAATAGACTTTCTAGTTATGGCTCTTAATAA AATAGTTCAAAACAAAAATAAATATTTAGAAAAATATGGTTAA
Upstream 100 bases:
>100_bases TCAGTACTCTAAATTCAAATAATCCCATAATATTTTTAAAAATTAAGTTACACTTTTTTATGTTTTTAATACTATATAGT AGGGGAATAGAGGTGATTAT
Downstream 100 bases:
>100_bases AATTTAACACCTATAAGTTTGTAGTATTTCCTATAACTTATAGGTGTTAATTTATACCTTTATAATTTAAATTTTTAAAA CCCTATATTTATAAATAAAT
Product: aminotransferase, class V
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 440; Mature: 440
Protein sequence:
>440_residues MYSNKRSPYRYLVVGSDTKVPLYNGQLTPCINFDNAATTPPLASVMNAIVNFSPWYSSIHRGTGYKSQLSSKIYEDSRKT VGKFIGADLDKDVIIYVKNTTEAINKLSYRLCSCDDDSIILTTSMEHHSNDLPWRDKYNVDYIEVDDCGRLVMEDLRSKL IRYGDKVKLVTIAGASNVTGYINPIYDIAKLVHEFGCKILVDGAQLVPHCKLSMKPHDSLEHIDYLAFSAHKMYAPFGIG VLIGPKETFERGDPDYKGGGTVNVVTKDYVLWTDPPEKDEAGTPNVMGVIALAKAIDTMTGIGMKNIEIYEQDIFEYAFR KIAQIPDIKIYSCKNLDYPRVAIIPFNISGMHHSITAEILSKEFGIAVRNGCFCAQPYVQKILNIPKEEIGSYANEPMNK RPGMVRLSFGMYNDIYEIDFLVMALNKIVQNKNKYLEKYG
Sequences:
>Translated_440_residues MYSNKRSPYRYLVVGSDTKVPLYNGQLTPCINFDNAATTPPLASVMNAIVNFSPWYSSIHRGTGYKSQLSSKIYEDSRKT VGKFIGADLDKDVIIYVKNTTEAINKLSYRLCSCDDDSIILTTSMEHHSNDLPWRDKYNVDYIEVDDCGRLVMEDLRSKL IRYGDKVKLVTIAGASNVTGYINPIYDIAKLVHEFGCKILVDGAQLVPHCKLSMKPHDSLEHIDYLAFSAHKMYAPFGIG VLIGPKETFERGDPDYKGGGTVNVVTKDYVLWTDPPEKDEAGTPNVMGVIALAKAIDTMTGIGMKNIEIYEQDIFEYAFR KIAQIPDIKIYSCKNLDYPRVAIIPFNISGMHHSITAEILSKEFGIAVRNGCFCAQPYVQKILNIPKEEIGSYANEPMNK RPGMVRLSFGMYNDIYEIDFLVMALNKIVQNKNKYLEKYG >Mature_440_residues MYSNKRSPYRYLVVGSDTKVPLYNGQLTPCINFDNAATTPPLASVMNAIVNFSPWYSSIHRGTGYKSQLSSKIYEDSRKT VGKFIGADLDKDVIIYVKNTTEAINKLSYRLCSCDDDSIILTTSMEHHSNDLPWRDKYNVDYIEVDDCGRLVMEDLRSKL IRYGDKVKLVTIAGASNVTGYINPIYDIAKLVHEFGCKILVDGAQLVPHCKLSMKPHDSLEHIDYLAFSAHKMYAPFGIG VLIGPKETFERGDPDYKGGGTVNVVTKDYVLWTDPPEKDEAGTPNVMGVIALAKAIDTMTGIGMKNIEIYEQDIFEYAFR KIAQIPDIKIYSCKNLDYPRVAIIPFNISGMHHSITAEILSKEFGIAVRNGCFCAQPYVQKILNIPKEEIGSYANEPMNK RPGMVRLSFGMYNDIYEIDFLVMALNKIVQNKNKYLEKYG
Specific function: Catalyzes the removal of elemental sulfur and selenium atoms from L-cysteine, L-cystine, L-selenocysteine, and L- selenocystine to produce L-alanine [H]
COG id: COG0520
COG function: function code E; Selenocysteine lyase
Gene ontology:
Cell location: Cytoplasmic
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the class-V pyridoxal-phosphate-dependent aminotransferase family. Csd subfamily [H]
Homologues:
Organism=Escherichia coli, GI1787970, Length=411, Percent_Identity=33.0900243309002, Blast_Score=211, Evalue=1e-55, Organism=Escherichia coli, GI1789175, Length=410, Percent_Identity=30.2439024390244, Blast_Score=169, Evalue=4e-43, Organism=Caenorhabditis elegans, GI193211090, Length=424, Percent_Identity=25.7075471698113, Blast_Score=135, Evalue=3e-32, Organism=Saccharomyces cerevisiae, GI6319831, Length=241, Percent_Identity=26.9709543568465, Blast_Score=64, Evalue=4e-11,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR000192 - InterPro: IPR010970 - InterPro: IPR015424 - InterPro: IPR015421 - InterPro: IPR015422 [H]
Pfam domain/function: PF00266 Aminotran_5 [H]
EC number: =2.8.1.7 [H]
Molecular weight: Translated: 49546; Mature: 49546
Theoretical pI: Translated: 7.02; Mature: 7.02
Prosite motif: PS00595 AA_TRANSFER_CLASS_5
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
2.0 %Cys (Translated Protein) 3.2 %Met (Translated Protein) 5.2 %Cys+Met (Translated Protein) 2.0 %Cys (Mature Protein) 3.2 %Met (Mature Protein) 5.2 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MYSNKRSPYRYLVVGSDTKVPLYNGQLTPCINFDNAATTPPLASVMNAIVNFSPWYSSIH CCCCCCCCEEEEEEECCCCCEEECCCCCEEEECCCCCCCCHHHHHHHHHHCCCHHHHHHH RGTGYKSQLSSKIYEDSRKTVGKFIGADLDKDVIIYVKNTTEAINKLSYRLCSCDDDSII CCCCCHHHHHHHHHHHHHHHHHHHHCCCCCCCEEEEECCCHHHHHHHHHHEECCCCCCEE LTTSMEHHSNDLPWRDKYNVDYIEVDDCGRLVMEDLRSKLIRYGDKVKLVTIAGASNVTG EEEEHHHCCCCCCCCCCCCCCEEEECCHHHHHHHHHHHHHHHCCCCEEEEEEECCCCCCC YINPIYDIAKLVHEFGCKILVDGAQLVPHCKLSMKPHDSLEHIDYLAFSAHKMYAPFGIG CCCHHHHHHHHHHHCCCEEEECCCHHCCCCEECCCCCCCHHHHHHHHHHHHHEECCCCCE VLIGPKETFERGDPDYKGGGTVNVVTKDYVLWTDPPEKDEAGTPNVMGVIALAKAIDTMT EEECCHHHHHCCCCCCCCCCEEEEEEECEEEECCCCCCCCCCCCCHHHHHHHHHHHHHHH GIGMKNIEIYEQDIFEYAFRKIAQIPDIKIYSCKNLDYPRVAIIPFNISGMHHSITAEIL CCCCCCHHHHHHHHHHHHHHHHHCCCCEEEEEECCCCCCEEEEEEEECCCCCHHHHHHHH SKEFGIAVRNGCFCAQPYVQKILNIPKEEIGSYANEPMNKRPGMVRLSFGMYNDIYEIDF HHHCCEEEECCEEECCHHHHHHHCCCHHHHHHHHCCCCCCCCCEEEEECCCCCCHHHHHH LVMALNKIVQNKNKYLEKYG HHHHHHHHHHHHHHHHHHCC >Mature Secondary Structure MYSNKRSPYRYLVVGSDTKVPLYNGQLTPCINFDNAATTPPLASVMNAIVNFSPWYSSIH CCCCCCCCEEEEEEECCCCCEEECCCCCEEEECCCCCCCCHHHHHHHHHHCCCHHHHHHH RGTGYKSQLSSKIYEDSRKTVGKFIGADLDKDVIIYVKNTTEAINKLSYRLCSCDDDSII CCCCCHHHHHHHHHHHHHHHHHHHHCCCCCCCEEEEECCCHHHHHHHHHHEECCCCCCEE LTTSMEHHSNDLPWRDKYNVDYIEVDDCGRLVMEDLRSKLIRYGDKVKLVTIAGASNVTG EEEEHHHCCCCCCCCCCCCCCEEEECCHHHHHHHHHHHHHHHCCCCEEEEEEECCCCCCC YINPIYDIAKLVHEFGCKILVDGAQLVPHCKLSMKPHDSLEHIDYLAFSAHKMYAPFGIG CCCHHHHHHHHHHHCCCEEEECCCHHCCCCEECCCCCCCHHHHHHHHHHHHHEECCCCCE VLIGPKETFERGDPDYKGGGTVNVVTKDYVLWTDPPEKDEAGTPNVMGVIALAKAIDTMT EEECCHHHHHCCCCCCCCCCEEEEEEECEEEECCCCCCCCCCCCCHHHHHHHHHHHHHHH GIGMKNIEIYEQDIFEYAFRKIAQIPDIKIYSCKNLDYPRVAIIPFNISGMHHSITAEIL CCCCCCHHHHHHHHHHHHHHHHHCCCCEEEEEECCCCCCEEEEEEEECCCCCHHHHHHHH SKEFGIAVRNGCFCAQPYVQKILNIPKEEIGSYANEPMNKRPGMVRLSFGMYNDIYEIDF HHHCCEEEECCEEECCHHHHHHHCCCHHHHHHHHCCCCCCCCCEEEEECCCCCCHHHHHH LVMALNKIVQNKNKYLEKYG HHHHHHHHHHHHHHHHHHCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: NA