| Definition | Clostridium botulinum A str. Hall, complete genome. |
|---|---|
| Accession | NC_009698 |
| Length | 3,760,560 |
Click here to switch to the map view.
The map label for this gene is kanC [H]
Identifier: 153937255
GI number: 153937255
Start: 2215742
End: 2216881
Strand: Reverse
Name: kanC [H]
Synonym: CLC_2089
Alternate gene names: 153937255
Gene position: 2216881-2215742 (Counterclockwise)
Preceding gene: 153934821
Following gene: 153937624
Centisome position: 58.95
GC content: 27.19
Gene sequence:
>1140_bases ATGTATATGAATTTAGCACAAAAAATTAATGATGATTATTATCATCCAGAGGTTAAACTTGAAACAAACTTATTAGAATC ATCTCCAATATATTTAGGGTGCAATATATGGAGAGAAAGTCTATTAGAAAAGATGATGGATTTAAATACAGATAAGTTTT TCTTAATTACAGACGATGTTGTATATAATTTGTTTGGAAAAGAACTATTGGAATATATGAATAGAAAAGTTTCAGTAAAA TTAATTAAATTGCCATCAGGTGAAAAACATAAAAATATAAAAGTGTTTAATGATTTAATGGAAGATTTATTTGATAACAA TGTAACTAAAAGTTCAATCTTAATTTCATTAGGTGGAGGTGTTGTAGGGAATATTACAGGATTGGCTGCTGCTTTAGCAT TTAGAGGTATTAGGTTTTTTCATATACCTACAACATTTATGTCTCAGACTGATAGCATTCTTAGCAGAAAACAAGGGATT AATTCTTTTTATGGTAAGAATATGATTGGATCATATTATACACCTTTATTTAATTTTATAGATACTTCATTTTTAACATT TGATAGTGAAAGATTCATAAGAGGTAGTTTTGTTGAAACTGTTAAAAATGGATTCATATATAATGCAGATTTTTTAAATA AACTTAAATCAGTAATTAAAAATGATTTTAATGTTAACCAAGAAGGCATTTTTAATTTAGTAAAAATGAGTATTGAATCA AAGTTACCAATAATGAAAGCAGATCCAACTGAAAAAGGTTTAGCTATGATTCTAGAATATGGTCATACCGTTGGACATGC AATAGAAAAGCTTTCATATGGAAAACTATCACATGGAGAAAGTGTATCAATTGGTATGATGGTTGCTGCTCGCGTAAGTG AAAAACTTGGTTACTTAAGTAAGCAGGATGTTAAGGAGCATCTGGATATATTATCAGCATTGAAGACACCTACAAAAATT CCTTCAAATATAAAAATTTCTGACATAATTAATAAAATAAAATTAGATAATAAAAAAGACATGAATGGTATAAGGTTTGT TGTTCTTGAAAGCATAGGAAAATGCATAAACACTGATGGTAGTTATATGATTAAGGTTCCTTTTAATATAATCAATGAGG CTATAGAAGAAACTTGTTAA
Upstream 100 bases:
>100_bases GAAGGAGTGATGTTTTAATTTAAAATATTAATAGATTGCTTTGTTTATCAGAGTAGTTTTGTTAAAAAACATATTATATA AATAAACAGGAGGAATGAAA
Downstream 100 bases:
>100_bases TTTTAGTGAATTTATTATAAAAATATACTAGATTTATAAGTTTAAAATAGGATATTTGATTTCAAAATTTAAAGGAGGAG AATATGTTAAAACTTGCTTA
Product: putative 3-dehydroquinate synthase
Products: dehydroquinate +phosphate [C]
Alternate protein names: DOI synthase; DOIS [H]
Number of amino acids: Translated: 379; Mature: 379
Protein sequence:
>379_residues MYMNLAQKINDDYYHPEVKLETNLLESSPIYLGCNIWRESLLEKMMDLNTDKFFLITDDVVYNLFGKELLEYMNRKVSVK LIKLPSGEKHKNIKVFNDLMEDLFDNNVTKSSILISLGGGVVGNITGLAAALAFRGIRFFHIPTTFMSQTDSILSRKQGI NSFYGKNMIGSYYTPLFNFIDTSFLTFDSERFIRGSFVETVKNGFIYNADFLNKLKSVIKNDFNVNQEGIFNLVKMSIES KLPIMKADPTEKGLAMILEYGHTVGHAIEKLSYGKLSHGESVSIGMMVAARVSEKLGYLSKQDVKEHLDILSALKTPTKI PSNIKISDIINKIKLDNKKDMNGIRFVVLESIGKCINTDGSYMIKVPFNIINEAIEETC
Sequences:
>Translated_379_residues MYMNLAQKINDDYYHPEVKLETNLLESSPIYLGCNIWRESLLEKMMDLNTDKFFLITDDVVYNLFGKELLEYMNRKVSVK LIKLPSGEKHKNIKVFNDLMEDLFDNNVTKSSILISLGGGVVGNITGLAAALAFRGIRFFHIPTTFMSQTDSILSRKQGI NSFYGKNMIGSYYTPLFNFIDTSFLTFDSERFIRGSFVETVKNGFIYNADFLNKLKSVIKNDFNVNQEGIFNLVKMSIES KLPIMKADPTEKGLAMILEYGHTVGHAIEKLSYGKLSHGESVSIGMMVAARVSEKLGYLSKQDVKEHLDILSALKTPTKI PSNIKISDIINKIKLDNKKDMNGIRFVVLESIGKCINTDGSYMIKVPFNIINEAIEETC >Mature_379_residues MYMNLAQKINDDYYHPEVKLETNLLESSPIYLGCNIWRESLLEKMMDLNTDKFFLITDDVVYNLFGKELLEYMNRKVSVK LIKLPSGEKHKNIKVFNDLMEDLFDNNVTKSSILISLGGGVVGNITGLAAALAFRGIRFFHIPTTFMSQTDSILSRKQGI NSFYGKNMIGSYYTPLFNFIDTSFLTFDSERFIRGSFVETVKNGFIYNADFLNKLKSVIKNDFNVNQEGIFNLVKMSIES KLPIMKADPTEKGLAMILEYGHTVGHAIEKLSYGKLSHGESVSIGMMVAARVSEKLGYLSKQDVKEHLDILSALKTPTKI PSNIKISDIINKIKLDNKKDMNGIRFVVLESIGKCINTDGSYMIKVPFNIINEAIEETC
Specific function: Catalyzes the intramolecular carbocycle formation from D-glucose-6-phosphate to 2-deoxy-scyllo-inosose (DOI) [H]
COG id: COG0337
COG function: function code E; 3-dehydroquinate synthetase
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the dehydroquinate synthase family. DOI synthase subfamily [H]
Homologues:
Organism=Escherichia coli, GI1789791, Length=306, Percent_Identity=31.6993464052288, Blast_Score=162, Evalue=3e-41, Organism=Saccharomyces cerevisiae, GI6320332, Length=319, Percent_Identity=29.7805642633229, Blast_Score=141, Evalue=2e-34,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR016303 - InterPro: IPR002658 [H]
Pfam domain/function: PF01761 DHQ_synthase [H]
EC number: 4.2.3.4 [C]
Molecular weight: Translated: 42855; Mature: 42855
Theoretical pI: Translated: 8.05; Mature: 8.05
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.8 %Cys (Translated Protein) 4.0 %Met (Translated Protein) 4.7 %Cys+Met (Translated Protein) 0.8 %Cys (Mature Protein) 4.0 %Met (Mature Protein) 4.7 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MYMNLAQKINDDYYHPEVKLETNLLESSPIYLGCNIWRESLLEKMMDLNTDKFFLITDDV CCCCHHHHCCCCCCCCCEEEEECHHCCCCEEEEHHHHHHHHHHHHHHCCCCEEEEEEHHH VYNLFGKELLEYMNRKVSVKLIKLPSGEKHKNIKVFNDLMEDLFDNNVTKSSILISLGGG HHHHHHHHHHHHHCCCEEEEEEECCCCCCCCCHHHHHHHHHHHHCCCCCCCEEEEEECCC VVGNITGLAAALAFRGIRFFHIPTTFMSQTDSILSRKQGINSFYGKNMIGSYYTPLFNFI CHHHHHHHHHHHHHCCEEEEECCHHHHHHHHHHHHHHHCCHHHHCCCCCHHHHHHHHHHH DTSFLTFDSERFIRGSFVETVKNGFIYNADFLNKLKSVIKNDFNVNQEGIFNLVKMSIES HHHHEEECCCHHHHHHHHHHHHCCCEECHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHH KLPIMKADPTEKGLAMILEYGHTVGHAIEKLSYGKLSHGESVSIGMMVAARVSEKLGYLS CCCCEECCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHCCCC KQDVKEHLDILSALKTPTKIPSNIKISDIINKIKLDNKKDMNGIRFVVLESIGKCINTDG HHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHCCCC SYMIKVPFNIINEAIEETC CEEEEECHHHHHHHHHHCC >Mature Secondary Structure MYMNLAQKINDDYYHPEVKLETNLLESSPIYLGCNIWRESLLEKMMDLNTDKFFLITDDV CCCCHHHHCCCCCCCCCEEEEECHHCCCCEEEEHHHHHHHHHHHHHHCCCCEEEEEEHHH VYNLFGKELLEYMNRKVSVKLIKLPSGEKHKNIKVFNDLMEDLFDNNVTKSSILISLGGG HHHHHHHHHHHHHCCCEEEEEEECCCCCCCCCHHHHHHHHHHHHCCCCCCCEEEEEECCC VVGNITGLAAALAFRGIRFFHIPTTFMSQTDSILSRKQGINSFYGKNMIGSYYTPLFNFI CHHHHHHHHHHHHHCCEEEEECCHHHHHHHHHHHHHHHCCHHHHCCCCCHHHHHHHHHHH DTSFLTFDSERFIRGSFVETVKNGFIYNADFLNKLKSVIKNDFNVNQEGIFNLVKMSIES HHHHEEECCCHHHHHHHHHHHHCCCEECHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHH KLPIMKADPTEKGLAMILEYGHTVGHAIEKLSYGKLSHGESVSIGMMVAARVSEKLGYLS CCCCEECCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHCCCC KQDVKEHLDILSALKTPTKIPSNIKISDIINKIKLDNKKDMNGIRFVVLESIGKCINTDG HHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHCCCC SYMIKVPFNIINEAIEETC CEEEEECHHHHHHHHHHCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NAD+ [C]
Metal ions: Co2+ [C]
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): 0.033 {3-deoxy-D-arabino-heptulosonic} [C]
Substrates: @DEOX04.txt*phospho-deoxy-arabino-heptulosonate! [C]
Specific reaction: @DEOX04.txt*phospho-deoxy-arabino-heptulosonate! = dehydroquinate +phosphate [C]
General reaction: elimination (P-O bond cleavage [C]
Inhibitor: 3-deoxy-D-arabino-heoptulosonic acid; 3-deoxy-D-arabino-heptulosonic acid7-homophosphate [C]
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: NA