Definition Clostridium botulinum A str. Hall, complete genome.
Accession NC_009698
Length 3,760,560

Click here to switch to the map view.

The map label for this gene is leuS

Identifier: 153935447

GI number: 153935447

Start: 216561

End: 219002

Strand: Reverse

Name: leuS

Synonym: CLC_0240

Alternate gene names: 153935447

Gene position: 219002-216561 (Counterclockwise)

Preceding gene: 153934709

Following gene: 153935874

Centisome position: 5.82

GC content: 31.08

Gene sequence:

>2442_bases
ATGGGAAACTATAGTACTAAAATCGACGAGAAATGGCAAAAAAAATGGGAAGAAAACTCTCTATACAAATTTAATAATAA
AAATTTAGATAAAAAATTATATGTACTTGAAATGTTTTCTTATCCATCAGGTAGTAAATTACATGCAGGACACTGGTTTA
ACTATGGGCCTGTAGACTCTTGGGCAAGATTTAAAAGAATGCAAGGTTACAATGTTTTTCAACCTATGGGTTTTGATGCT
TTTGGTCTTCCAGCTGAAAACTATGCAATAAAAACTGGTATACATCCAAAGGATTCTACCTTTAAAAATATTGAAACTAT
GGAAACTCAATTAAAAGCCATGGGTGCCATGTTCAACTGGGAAAATGAAGTTATAACTTGTTCACCAGACTACTATAAAT
GGACTCAATGGTTATTTTTAAAACTTTACGAAAAGGGTTTAGCTTATAAAAAGAAAGCACCTGTAAATTGGTGCCCAAGT
TGTAATACTGTTCTTGCTAATGAACAGGTTTTAGATGGAAAATGTGAAAGATGTGATAGCAATGTTGATAAAAAAAATCT
AGAGCAATGGTTCTTAAAGATAACTGACTATGCTGATGAATTATTAGAAAAACTCGATGAATTAGATTGGCCTGAAAAAA
CTAAGGCTATGCAAAAACACTGGATTGGAAAATCTGTAGGTGCTGAAGTTACATTTAATGTAGCAGATTCAGACTTGAGC
TTTAATGTATTTACTACAAGGGTAGATACTTTATTTGGAGTTACTTATGTAGTTTTAGCTCCTGAAAATGATTTAGTAGA
TAAGCTAACTACTCCTGAAAACAAAGCTGAAGTTGAATCATATAAAACTCAAGCTAAAAATCAATCTGATATAGAAAGAC
AATCTATAACTCGAGAAAAAACTGGTGTATTCTCAGGCTCTTATGCCATAAATCCTATAAACGGTAAAAAAGTACCTATA
TGGATAGGAGATTATGTATTAAATACCTATGGAACAGGTTGTGTAATGGCAGTTCCTGCCCATGATGAAAGAGATTTCGC
TTTTGCTACTAAATATAACCTTCCTATAGAAAGAGTTATAGAAGGCGGTGATTCTCTTCCTTATACAGAATATGGTGGAA
TGGTTAATAGTGGAGAATTCGATGGTTTATTGGGAAATGAGGCTAAAGAAGCTGTAATTTCTAAGTTAGAGTCTATGAAT
CTTGGTAGAAAGAAAATAAATTATAGATTAAGAGATTGGCTTGTATCAAGACAAAGATATTGGGGAGCACCTATTCCTAT
AATTTATTGTGAAAAATGTGGTACAGTGGAAGTTCCTATAGAACAGCTCCCTGTAGAATTACCATATAATGTAGAATTCT
CTCCAGATGGGAAATCACCTTTAGGTAAATGTGATGACTTTATAAATACAACTTGCCCAAAATGTGGTGGTCCAGCAAAA
AGAGAAGCGGACACATTAGATACCTTTGTATGTTCTTCTTGGTACTATTTAAGATATCCAGATAATAATAACGAAAAAGA
TGCTTTTAATCCTGAATTAATAAATAAAATGCTTCCAGTTGATAAATATGTTGGCGGTCCTGAACACGCTTGTATGCATC
TTTTATATGCTAGATTTATAACTAAAGCTTTAAGAGATATGGGGTATCTAAACTTTGATGAACCATTCTTATCTCTTACT
CATCAAGGATTAATATTAGGACCTGATGGCTTAAAAATGAGTAAATCAAAAGGAAATACTATATCTCCTGATGATTATAT
AAAAGAATTCGGTGCAGATGTATTTAGAATGTATTTAATGTTTGGATTTGATTATACAGAAGGCGGCGCTTGGAGTGACG
ATGCTATAAAATCCATAGGTAAATTTGTAGACAGAGTAGAAAGAATATTAGAAAATGCTAGAGAAGAAATAAAAAATTCT
AAAGATAATAAATCTACTATGGATAAAGATGAGAAAGAATTAAACTACGTAAGGCATCATAGCATTAAATCTATAACTGA
AGATATAGATAAAATGCAGTTCAATACTTCCATAGCAAGATTAATGGAATTTACAAATGCTCTATCTAAATATCTTGGTA
TTGATGCTATTAAAAATGCTTTATTCTTGAGAGAAAGTATAATTGACTTTATAACATTATTAGCACCTTTTGCTCCTCAT
TTTGCTGAAGAACAATGGAAACTTATAGGCATTAATTCTTCCATTTTCAATGAAAAATGGCCTGAATTTGACCCTAAAGC
CCTAATAAAAGATGAAGTTGAAATAGCCGTACAAGTAAATGGGAAAATAAGAGCTAAAATAAATATATCTACTAGTTCAT
CAGAAGATGAAATAAAAGAATCAGCATTAAATAATGAGGATATTAAAAATTCTATAGGTGATAAAGAAATTAAAAAAGTT
ATAGTAATAAAAAATAGATTAGTTAATATAGTTGCTAAATAA

Upstream 100 bases:

>100_bases
TTAGGAGATGAAGGTTTTTTTATTTTATATAAAAATATTTAATTATTATTTTAAATTTTATTTATAAATAATAGTTAATG
AAATAGATAGGAGGATTTTT

Downstream 100 bases:

>100_bases
AATTAAAAAGGCTGTCTCAAAATAAAAATAGATTTAATTTTAACCCGCAAATATAGAAAATACATTTATAAGGCACTTCA
TTTTGCTAAGAAGTTCTAAA

Product: leucyl-tRNA synthetase

Products: NA

Alternate protein names: Leucine--tRNA ligase; LeuRS

Number of amino acids: Translated: 813; Mature: 812

Protein sequence:

>813_residues
MGNYSTKIDEKWQKKWEENSLYKFNNKNLDKKLYVLEMFSYPSGSKLHAGHWFNYGPVDSWARFKRMQGYNVFQPMGFDA
FGLPAENYAIKTGIHPKDSTFKNIETMETQLKAMGAMFNWENEVITCSPDYYKWTQWLFLKLYEKGLAYKKKAPVNWCPS
CNTVLANEQVLDGKCERCDSNVDKKNLEQWFLKITDYADELLEKLDELDWPEKTKAMQKHWIGKSVGAEVTFNVADSDLS
FNVFTTRVDTLFGVTYVVLAPENDLVDKLTTPENKAEVESYKTQAKNQSDIERQSITREKTGVFSGSYAINPINGKKVPI
WIGDYVLNTYGTGCVMAVPAHDERDFAFATKYNLPIERVIEGGDSLPYTEYGGMVNSGEFDGLLGNEAKEAVISKLESMN
LGRKKINYRLRDWLVSRQRYWGAPIPIIYCEKCGTVEVPIEQLPVELPYNVEFSPDGKSPLGKCDDFINTTCPKCGGPAK
READTLDTFVCSSWYYLRYPDNNNEKDAFNPELINKMLPVDKYVGGPEHACMHLLYARFITKALRDMGYLNFDEPFLSLT
HQGLILGPDGLKMSKSKGNTISPDDYIKEFGADVFRMYLMFGFDYTEGGAWSDDAIKSIGKFVDRVERILENAREEIKNS
KDNKSTMDKDEKELNYVRHHSIKSITEDIDKMQFNTSIARLMEFTNALSKYLGIDAIKNALFLRESIIDFITLLAPFAPH
FAEEQWKLIGINSSIFNEKWPEFDPKALIKDEVEIAVQVNGKIRAKINISTSSSEDEIKESALNNEDIKNSIGDKEIKKV
IVIKNRLVNIVAK

Sequences:

>Translated_813_residues
MGNYSTKIDEKWQKKWEENSLYKFNNKNLDKKLYVLEMFSYPSGSKLHAGHWFNYGPVDSWARFKRMQGYNVFQPMGFDA
FGLPAENYAIKTGIHPKDSTFKNIETMETQLKAMGAMFNWENEVITCSPDYYKWTQWLFLKLYEKGLAYKKKAPVNWCPS
CNTVLANEQVLDGKCERCDSNVDKKNLEQWFLKITDYADELLEKLDELDWPEKTKAMQKHWIGKSVGAEVTFNVADSDLS
FNVFTTRVDTLFGVTYVVLAPENDLVDKLTTPENKAEVESYKTQAKNQSDIERQSITREKTGVFSGSYAINPINGKKVPI
WIGDYVLNTYGTGCVMAVPAHDERDFAFATKYNLPIERVIEGGDSLPYTEYGGMVNSGEFDGLLGNEAKEAVISKLESMN
LGRKKINYRLRDWLVSRQRYWGAPIPIIYCEKCGTVEVPIEQLPVELPYNVEFSPDGKSPLGKCDDFINTTCPKCGGPAK
READTLDTFVCSSWYYLRYPDNNNEKDAFNPELINKMLPVDKYVGGPEHACMHLLYARFITKALRDMGYLNFDEPFLSLT
HQGLILGPDGLKMSKSKGNTISPDDYIKEFGADVFRMYLMFGFDYTEGGAWSDDAIKSIGKFVDRVERILENAREEIKNS
KDNKSTMDKDEKELNYVRHHSIKSITEDIDKMQFNTSIARLMEFTNALSKYLGIDAIKNALFLRESIIDFITLLAPFAPH
FAEEQWKLIGINSSIFNEKWPEFDPKALIKDEVEIAVQVNGKIRAKINISTSSSEDEIKESALNNEDIKNSIGDKEIKKV
IVIKNRLVNIVAK
>Mature_812_residues
GNYSTKIDEKWQKKWEENSLYKFNNKNLDKKLYVLEMFSYPSGSKLHAGHWFNYGPVDSWARFKRMQGYNVFQPMGFDAF
GLPAENYAIKTGIHPKDSTFKNIETMETQLKAMGAMFNWENEVITCSPDYYKWTQWLFLKLYEKGLAYKKKAPVNWCPSC
NTVLANEQVLDGKCERCDSNVDKKNLEQWFLKITDYADELLEKLDELDWPEKTKAMQKHWIGKSVGAEVTFNVADSDLSF
NVFTTRVDTLFGVTYVVLAPENDLVDKLTTPENKAEVESYKTQAKNQSDIERQSITREKTGVFSGSYAINPINGKKVPIW
IGDYVLNTYGTGCVMAVPAHDERDFAFATKYNLPIERVIEGGDSLPYTEYGGMVNSGEFDGLLGNEAKEAVISKLESMNL
GRKKINYRLRDWLVSRQRYWGAPIPIIYCEKCGTVEVPIEQLPVELPYNVEFSPDGKSPLGKCDDFINTTCPKCGGPAKR
EADTLDTFVCSSWYYLRYPDNNNEKDAFNPELINKMLPVDKYVGGPEHACMHLLYARFITKALRDMGYLNFDEPFLSLTH
QGLILGPDGLKMSKSKGNTISPDDYIKEFGADVFRMYLMFGFDYTEGGAWSDDAIKSIGKFVDRVERILENAREEIKNSK
DNKSTMDKDEKELNYVRHHSIKSITEDIDKMQFNTSIARLMEFTNALSKYLGIDAIKNALFLRESIIDFITLLAPFAPHF
AEEQWKLIGINSSIFNEKWPEFDPKALIKDEVEIAVQVNGKIRAKINISTSSSEDEIKESALNNEDIKNSIGDKEIKKVI
VIKNRLVNIVAK

Specific function: Unknown

COG id: COG0495

COG function: function code J; Leucyl-tRNA synthetase

Gene ontology:

Cell location: Cytoplasm

Metaboloic importance: Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the class-I aminoacyl-tRNA synthetase family

Homologues:

Organism=Homo sapiens, GI7661872, Length=870, Percent_Identity=33.3333333333333, Blast_Score=468, Evalue=1e-131,
Organism=Escherichia coli, GI1786861, Length=858, Percent_Identity=40.6759906759907, Blast_Score=644, Evalue=0.0,
Organism=Escherichia coli, GI2367096, Length=322, Percent_Identity=26.0869565217391, Blast_Score=72, Evalue=2e-13,
Organism=Caenorhabditis elegans, GI71997510, Length=811, Percent_Identity=29.0998766954377, Blast_Score=312, Evalue=5e-85,
Organism=Caenorhabditis elegans, GI71997517, Length=806, Percent_Identity=28.6600496277916, Blast_Score=311, Evalue=9e-85,
Organism=Caenorhabditis elegans, GI212645227, Length=325, Percent_Identity=29.2307692307692, Blast_Score=125, Evalue=9e-29,
Organism=Saccharomyces cerevisiae, GI6323414, Length=876, Percent_Identity=36.3013698630137, Blast_Score=512, Evalue=1e-146,
Organism=Saccharomyces cerevisiae, GI6321531, Length=374, Percent_Identity=24.0641711229947, Blast_Score=90, Evalue=1e-18,
Organism=Drosophila melanogaster, GI21355409, Length=859, Percent_Identity=32.8288707799767, Blast_Score=415, Evalue=1e-116,

Paralogues:

None

Copy number: 800 Molecules/Cell In: Glucose minimal media [C]

Swissprot (AC and ID): SYL_CLOB1 (A7FPP5)

Other databases:

- EMBL:   CP000726
- RefSeq:   YP_001382590.1
- ProteinModelPortal:   A7FPP5
- SMR:   A7FPP5
- STRING:   A7FPP5
- GeneID:   5396762
- GenomeReviews:   CP000726_GR
- KEGG:   cba:CLB_0226
- eggNOG:   COG0495
- HOGENOM:   HBG693845
- OMA:   ERGNFPV
- ProtClustDB:   PRK00390
- BioCyc:   CBOT441770:CLB_0226-MONOMER
- GO:   GO:0005737
- HAMAP:   MF_00049_B
- InterPro:   IPR002300
- InterPro:   IPR002302
- InterPro:   IPR014729
- InterPro:   IPR009080
- InterPro:   IPR013155
- InterPro:   IPR009008
- Gene3D:   G3DSA:3.40.50.620
- PANTHER:   PTHR11946:SF7
- PRINTS:   PR00985
- TIGRFAMs:   TIGR00396

Pfam domain/function: PF08264 Anticodon_1; PF00133 tRNA-synt_1; SSF47323 tRNAsyn_1a_bind; SSF50677 ValRS_IleRS_edit

EC number: =6.1.1.4

Molecular weight: Translated: 92912; Mature: 92781

Theoretical pI: Translated: 5.39; Mature: 5.39

Prosite motif: PS00178 AA_TRNA_LIGASE_I

Important sites: BINDING 575-575

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.6 %Cys     (Translated Protein)
2.5 %Met     (Translated Protein)
4.1 %Cys+Met (Translated Protein)
1.6 %Cys     (Mature Protein)
2.3 %Met     (Mature Protein)
3.9 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MGNYSTKIDEKWQKKWEENSLYKFNNKNLDKKLYVLEMFSYPSGSKLHAGHWFNYGPVDS
CCCCCCCHHHHHHHHHCCCCEEEECCCCCCCEEEEEEEECCCCCCCEECCCCCCCCCHHH
WARFKRMQGYNVFQPMGFDAFGLPAENYAIKTGIHPKDSTFKNIETMETQLKAMGAMFNW
HHHHHHHCCCCCCCCCCCCCCCCCCCCCEEECCCCCCCCCHHHHHHHHHHHHHHHHHCCC
ENEVITCSPDYYKWTQWLFLKLYEKGLAYKKKAPVNWCPSCNTVLANEQVLDGKCERCDS
CCCEEEECCCHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCEEECCCHHHCCHHHHHCC
NVDKKNLEQWFLKITDYADELLEKLDELDWPEKTKAMQKHWIGKSVGAEVTFNVADSDLS
CCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHCCCCCCCEEEEEEECCCCE
FNVFTTRVDTLFGVTYVVLAPENDLVDKLTTPENKAEVESYKTQAKNQSDIERQSITREK
EEEHHHHHHHHHCCEEEEECCCCHHHHHCCCCCCHHHHHHHHHHCCCHHHHHHHHHHHHH
TGVFSGSYAINPINGKKVPIWIGDYVLNTYGTGCVMAVPAHDERDFAFATKYNLPIERVI
HCCCCCCEEECCCCCCEEEEEECCHHHHCCCCCEEEEECCCCCCCEEEEEECCCCHHHHH
EGGDSLPYTEYGGMVNSGEFDGLLGNEAKEAVISKLESMNLGRKKINYRLRDWLVSRQRY
CCCCCCCCHHHCCCCCCCCCCCCCCCHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHH
WGAPIPIIYCEKCGTVEVPIEQLPVELPYNVEFSPDGKSPLGKCDDFINTTCPKCGGPAK
CCCCCCEEEECCCCCEECCHHHCCCCCCCCEEECCCCCCCCHHHHHHHHCCCCCCCCCCC
READTLDTFVCSSWYYLRYPDNNNEKDAFNPELINKMLPVDKYVGGPEHACMHLLYARFI
CCHHHHHHHHHCCEEEEECCCCCCCCCCCCHHHHHHHCCHHHHCCCHHHHHHHHHHHHHH
TKALRDMGYLNFDEPFLSLTHQGLILGPDGLKMSKSKGNTISPDDYIKEFGADVFRMYLM
HHHHHHCCCCCCCCHHHHHCCCCEEECCCCCEECCCCCCCCCHHHHHHHHHHHHHHHHHH
FGFDYTEGGAWSDDAIKSIGKFVDRVERILENAREEIKNSKDNKSTMDKDEKELNYVRHH
HCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHCCCHHHHHHHHHHH
SIKSITEDIDKMQFNTSIARLMEFTNALSKYLGIDAIKNALFLRESIIDFITLLAPFAPH
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCH
FAEEQWKLIGINSSIFNEKWPEFDPKALIKDEVEIAVQVNGKIRAKINISTSSSEDEIKE
HHCCCEEEEECCHHHHCCCCCCCCCHHHHCCCEEEEEEECCEEEEEEEECCCCCHHHHHH
SALNNEDIKNSIGDKEIKKVIVIKNRLVNIVAK
HHCCCHHHHHHCCHHHHHHHHHHHHHHHHHHCC
>Mature Secondary Structure 
GNYSTKIDEKWQKKWEENSLYKFNNKNLDKKLYVLEMFSYPSGSKLHAGHWFNYGPVDS
CCCCCCHHHHHHHHHCCCCEEEECCCCCCCEEEEEEEECCCCCCCEECCCCCCCCCHHH
WARFKRMQGYNVFQPMGFDAFGLPAENYAIKTGIHPKDSTFKNIETMETQLKAMGAMFNW
HHHHHHHCCCCCCCCCCCCCCCCCCCCCEEECCCCCCCCCHHHHHHHHHHHHHHHHHCCC
ENEVITCSPDYYKWTQWLFLKLYEKGLAYKKKAPVNWCPSCNTVLANEQVLDGKCERCDS
CCCEEEECCCHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCEEECCCHHHCCHHHHHCC
NVDKKNLEQWFLKITDYADELLEKLDELDWPEKTKAMQKHWIGKSVGAEVTFNVADSDLS
CCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHCCCCCCCEEEEEEECCCCE
FNVFTTRVDTLFGVTYVVLAPENDLVDKLTTPENKAEVESYKTQAKNQSDIERQSITREK
EEEHHHHHHHHHCCEEEEECCCCHHHHHCCCCCCHHHHHHHHHHCCCHHHHHHHHHHHHH
TGVFSGSYAINPINGKKVPIWIGDYVLNTYGTGCVMAVPAHDERDFAFATKYNLPIERVI
HCCCCCCEEECCCCCCEEEEEECCHHHHCCCCCEEEEECCCCCCCEEEEEECCCCHHHHH
EGGDSLPYTEYGGMVNSGEFDGLLGNEAKEAVISKLESMNLGRKKINYRLRDWLVSRQRY
CCCCCCCCHHHCCCCCCCCCCCCCCCHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHH
WGAPIPIIYCEKCGTVEVPIEQLPVELPYNVEFSPDGKSPLGKCDDFINTTCPKCGGPAK
CCCCCCEEEECCCCCEECCHHHCCCCCCCCEEECCCCCCCCHHHHHHHHCCCCCCCCCCC
READTLDTFVCSSWYYLRYPDNNNEKDAFNPELINKMLPVDKYVGGPEHACMHLLYARFI
CCHHHHHHHHHCCEEEEECCCCCCCCCCCCHHHHHHHCCHHHHCCCHHHHHHHHHHHHHH
TKALRDMGYLNFDEPFLSLTHQGLILGPDGLKMSKSKGNTISPDDYIKEFGADVFRMYLM
HHHHHHCCCCCCCCHHHHHCCCCEEECCCCCEECCCCCCCCCHHHHHHHHHHHHHHHHHH
FGFDYTEGGAWSDDAIKSIGKFVDRVERILENAREEIKNSKDNKSTMDKDEKELNYVRHH
HCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHCCCHHHHHHHHHHH
SIKSITEDIDKMQFNTSIARLMEFTNALSKYLGIDAIKNALFLRESIIDFITLLAPFAPH
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCH
FAEEQWKLIGINSSIFNEKWPEFDPKALIKDEVEIAVQVNGKIRAKINISTSSSEDEIKE
HHCCCEEEEECCHHHHCCCCCCCCCHHHHCCCEEEEEEECCEEEEEEEECCCCCHHHHHH
SALNNEDIKNSIGDKEIKKVIVIKNRLVNIVAK
HHCCCHHHHHHCCHHHHHHHHHHHHHHHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA