Definition Thermoanaerobacter tengcongensis MB4, complete genome.
Accession NC_003869
Length 2,689,445

Click here to switch to the map view.

The map label for this gene is leuS

Identifier: 20806841

GI number: 20806841

Start: 341338

End: 343797

Strand: Direct

Name: leuS

Synonym: TTE0324

Alternate gene names: 20806841

Gene position: 341338-343797 (Clockwise)

Preceding gene: 20806838

Following gene: 20806842

Centisome position: 12.69

GC content: 40.16

Gene sequence:

>2460_bases
GTGGAGGATATGGCGTATTCAGTGGAGATTGATAGGAAATGGCAGAAAATCTGGGAAGAGACAAAACTTTACAAGTTTAA
TCCTGAAAATGTGGACAAAAAGCTTTATTGTTTAGAGATGTTTCCGTACCCTTCAGGGGCAAAATTGCACATAGGTCACT
GGTATAATTACGGTCCTACAGATTCATGGGCAAGAATGAAGAGGATGCAGGGCTATGAAGTATTCCACCCTATGGGGTTT
GACGCCTTTGGCCTTCCTGCTGAAAATTATGCCATAAAGACAGGCATACACCCTTATGACTCGACAATGGAAAACATAAG
GACCATGGAAAGACAACTCAGAGAAATGGGAGTCACTTTTGACTGGGACTATGAGATTATAACCTGTCTGCCAGAGTACT
ATAAATGGACTCAGTGGATTTTCTTAAAACTTTATGAAGCAGGTCTTGCCTACAGAAAGAAAGCGCCTGTAAACTGGTGT
CCCAGCTGCCAGACTGTTCTTGCAAACGAACAGGTAATTGATGGGAAATGCGAAAGGTGCGGAACTGAAGTTACAAAGAA
AGAGCTTACTCAGTGGTTTTTCAAAATAACTGCCTATGCGGAAGAACTTTTAGAAAAATTAGATGATCTTGATTGGCCTG
AAAAAACTAAAATGATGCAGAGGAACTGGATTGGAAAATCTGAGGGCGCAGAGATAGAGTTTAAAATTGATGGGAAAGAC
TTGTCTTTTAGAGTTTTTACCACAAGGGCAGATACGCTGTTTGGAGCAACTTATGTGGTATTGGCTCCTGAGCATGAATT
GGTGGATTTGATTACTACAGAGGAATATAAAGAGGCTGTGGAAGAATACAAAGAGTATGCCAAAAAGCAGAGTGAGATTG
AGAGGCTTTCAACAGAAAAGGAAAAGACAGGAGTGTTTACAGGAGCGTACGCGATTCATCCGCTGACAGGTGAAAAACTC
CCTATTTGGATAGCGGATTATGTGCTTGTAACTTACGGTACTGGATGTGTTATGGGAGTTCCTGGTCATGATGAAAGAGA
CTATGAATTTGCGACAAAATACAATCTGCCTATAAAAAGAGTTATAAAAGGAGTTGGAGATGTAGACGACAGTTTGCCTT
TTGTGGAATATGGAATTTTAGTAAATAGCGAAGAATTTACGGGGATGACATCTGAGGAAGCGCGAGTCAAAATAGTCGAA
AAGTTGAAAGCAGAAGGGAAAGCAGAGTTTAAAGTAAATTATAGGATGAGGGACTGGCTTGTGTCCAGACAGAGGTACTG
GGGAGCTCCCATTCCTATAATCCACTGCGAACGCTGTGGAATAGTGCCTGTGCCAGAAGAGGATTTACCTGTACTTTTGC
CATATGATGTTGAGTTTGAGCCAACAGGAGAATCTCCTCTTAAAAAGCATGCAGGTTTTATGAATGTCACCTGCCCTAAG
TGCGGAGGTCCGGCTTTAAGAGATCCTGATACTCTTGATACTTTTGTAGATTCTTCTTGGTATTACTTGAGATACCCTGA
CAATAAAAACGATAAAGAGCCTTTTAATAAAGAGTGGATAAACAAAATGCTTCCAGTAGATAAATATGTAGGTGGAGCAG
AGCACGCCACTATGCACCTTTTGTATTCGAGGTTTATAACGAAAGTTTTAAGAGATCTGGGATACCTTAATTTTGATGAA
CCTTTCCTTTCACTTGTGCATCAGGGGACGATTTTAGGGCCGGATGGCAGCAGAATGAGCAAATCAAGAGGGAATGTTAT
TTCGCCGGATGACTATATTAAACAGTACGGTTCAGATGTATTTAGGCTGTATCTAATGTTTGGCTTCTCTTACTCAGAGG
GCGGACCATGGAGCGATGAAGGAATAAAGGCTATTGCTAGATTTGTCAATAGGGTGGAGAGGTTTATAGAAAAATTTATT
GAGACCAGACAAAATCCAGGGAAGACAAAAGAAGAAATGGAAGATGCGGAAAAAGAATTGAACTATGTGAGACATTACAC
TATAAAACACGTGACATTGGATGCCGATAAATTTGAGTTCAACACTGCTATAGCGAGAATAATGGAACTTGTAAATGCTT
TGTACAAATATGAAAATGAGGTTGAAGTAAAGAACATGAAATTTTATGAAGATGTGGTAAGAGATTTTGTAAAAATCCTG
GCGCCCTTTGCGCCCCATTTCTCTGAAGAGATGTGGGAAAGACTGGGGTATGAATATTCTGTTTTCAATCAGAAGTGGCC
TGAGTGGGACGAAAAAGCCCTTGAAAGAGACATGATAGAAATTGCTATTCAGGTAAACGGAAAGGTTAGAAGCAAGGCTC
AAGTGCCTTCAAATGCGACGGATGAAGAGTTGAAGCAGATTGCTCTTTCTGATGAGAGAGTGAAATCTTACCTGGATGGC
AAAGAAATAAAGAAAGTGATAATTGTAAAAAATAGACTTGTAAATATTGTGGTAAACTAA

Upstream 100 bases:

>100_bases
GGGCGCTTTTGCGCCAAAAAGAGTGGTACCGCGGAAGATGTGGGTCTTTCGTCTCTTTGAGATGAAAGGCTTTTTTTAAT
GGAAAAATTAAAAAGTAGAG

Downstream 100 bases:

>100_bases
GGCAGGGCTTGCCCCTGCTTTAGTTTTTGGTATAATTTAGTGTGGAGGTGAGTAATTTGGTGAAAGCTGAGGCTGTAATT
GATAGCATAGTAAAGAAATT

Product: leucyl-tRNA synthetase

Products: NA

Alternate protein names: Leucine--tRNA ligase; LeuRS

Number of amino acids: Translated: 819; Mature: 819

Protein sequence:

>819_residues
MEDMAYSVEIDRKWQKIWEETKLYKFNPENVDKKLYCLEMFPYPSGAKLHIGHWYNYGPTDSWARMKRMQGYEVFHPMGF
DAFGLPAENYAIKTGIHPYDSTMENIRTMERQLREMGVTFDWDYEIITCLPEYYKWTQWIFLKLYEAGLAYRKKAPVNWC
PSCQTVLANEQVIDGKCERCGTEVTKKELTQWFFKITAYAEELLEKLDDLDWPEKTKMMQRNWIGKSEGAEIEFKIDGKD
LSFRVFTTRADTLFGATYVVLAPEHELVDLITTEEYKEAVEEYKEYAKKQSEIERLSTEKEKTGVFTGAYAIHPLTGEKL
PIWIADYVLVTYGTGCVMGVPGHDERDYEFATKYNLPIKRVIKGVGDVDDSLPFVEYGILVNSEEFTGMTSEEARVKIVE
KLKAEGKAEFKVNYRMRDWLVSRQRYWGAPIPIIHCERCGIVPVPEEDLPVLLPYDVEFEPTGESPLKKHAGFMNVTCPK
CGGPALRDPDTLDTFVDSSWYYLRYPDNKNDKEPFNKEWINKMLPVDKYVGGAEHATMHLLYSRFITKVLRDLGYLNFDE
PFLSLVHQGTILGPDGSRMSKSRGNVISPDDYIKQYGSDVFRLYLMFGFSYSEGGPWSDEGIKAIARFVNRVERFIEKFI
ETRQNPGKTKEEMEDAEKELNYVRHYTIKHVTLDADKFEFNTAIARIMELVNALYKYENEVEVKNMKFYEDVVRDFVKIL
APFAPHFSEEMWERLGYEYSVFNQKWPEWDEKALERDMIEIAIQVNGKVRSKAQVPSNATDEELKQIALSDERVKSYLDG
KEIKKVIIVKNRLVNIVVN

Sequences:

>Translated_819_residues
MEDMAYSVEIDRKWQKIWEETKLYKFNPENVDKKLYCLEMFPYPSGAKLHIGHWYNYGPTDSWARMKRMQGYEVFHPMGF
DAFGLPAENYAIKTGIHPYDSTMENIRTMERQLREMGVTFDWDYEIITCLPEYYKWTQWIFLKLYEAGLAYRKKAPVNWC
PSCQTVLANEQVIDGKCERCGTEVTKKELTQWFFKITAYAEELLEKLDDLDWPEKTKMMQRNWIGKSEGAEIEFKIDGKD
LSFRVFTTRADTLFGATYVVLAPEHELVDLITTEEYKEAVEEYKEYAKKQSEIERLSTEKEKTGVFTGAYAIHPLTGEKL
PIWIADYVLVTYGTGCVMGVPGHDERDYEFATKYNLPIKRVIKGVGDVDDSLPFVEYGILVNSEEFTGMTSEEARVKIVE
KLKAEGKAEFKVNYRMRDWLVSRQRYWGAPIPIIHCERCGIVPVPEEDLPVLLPYDVEFEPTGESPLKKHAGFMNVTCPK
CGGPALRDPDTLDTFVDSSWYYLRYPDNKNDKEPFNKEWINKMLPVDKYVGGAEHATMHLLYSRFITKVLRDLGYLNFDE
PFLSLVHQGTILGPDGSRMSKSRGNVISPDDYIKQYGSDVFRLYLMFGFSYSEGGPWSDEGIKAIARFVNRVERFIEKFI
ETRQNPGKTKEEMEDAEKELNYVRHYTIKHVTLDADKFEFNTAIARIMELVNALYKYENEVEVKNMKFYEDVVRDFVKIL
APFAPHFSEEMWERLGYEYSVFNQKWPEWDEKALERDMIEIAIQVNGKVRSKAQVPSNATDEELKQIALSDERVKSYLDG
KEIKKVIIVKNRLVNIVVN
>Mature_819_residues
MEDMAYSVEIDRKWQKIWEETKLYKFNPENVDKKLYCLEMFPYPSGAKLHIGHWYNYGPTDSWARMKRMQGYEVFHPMGF
DAFGLPAENYAIKTGIHPYDSTMENIRTMERQLREMGVTFDWDYEIITCLPEYYKWTQWIFLKLYEAGLAYRKKAPVNWC
PSCQTVLANEQVIDGKCERCGTEVTKKELTQWFFKITAYAEELLEKLDDLDWPEKTKMMQRNWIGKSEGAEIEFKIDGKD
LSFRVFTTRADTLFGATYVVLAPEHELVDLITTEEYKEAVEEYKEYAKKQSEIERLSTEKEKTGVFTGAYAIHPLTGEKL
PIWIADYVLVTYGTGCVMGVPGHDERDYEFATKYNLPIKRVIKGVGDVDDSLPFVEYGILVNSEEFTGMTSEEARVKIVE
KLKAEGKAEFKVNYRMRDWLVSRQRYWGAPIPIIHCERCGIVPVPEEDLPVLLPYDVEFEPTGESPLKKHAGFMNVTCPK
CGGPALRDPDTLDTFVDSSWYYLRYPDNKNDKEPFNKEWINKMLPVDKYVGGAEHATMHLLYSRFITKVLRDLGYLNFDE
PFLSLVHQGTILGPDGSRMSKSRGNVISPDDYIKQYGSDVFRLYLMFGFSYSEGGPWSDEGIKAIARFVNRVERFIEKFI
ETRQNPGKTKEEMEDAEKELNYVRHYTIKHVTLDADKFEFNTAIARIMELVNALYKYENEVEVKNMKFYEDVVRDFVKIL
APFAPHFSEEMWERLGYEYSVFNQKWPEWDEKALERDMIEIAIQVNGKVRSKAQVPSNATDEELKQIALSDERVKSYLDG
KEIKKVIIVKNRLVNIVVN

Specific function: Unknown

COG id: COG0495

COG function: function code J; Leucyl-tRNA synthetase

Gene ontology:

Cell location: Cytoplasm

Metaboloic importance: Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the class-I aminoacyl-tRNA synthetase family

Homologues:

Organism=Homo sapiens, GI7661872, Length=873, Percent_Identity=34.8224513172967, Blast_Score=511, Evalue=1e-145,
Organism=Escherichia coli, GI1786861, Length=860, Percent_Identity=42.906976744186, Blast_Score=674, Evalue=0.0,
Organism=Escherichia coli, GI1790708, Length=371, Percent_Identity=23.989218328841, Blast_Score=95, Evalue=1e-20,
Organism=Caenorhabditis elegans, GI71997510, Length=794, Percent_Identity=31.2342569269521, Blast_Score=345, Evalue=8e-95,
Organism=Caenorhabditis elegans, GI71997517, Length=810, Percent_Identity=30.8641975308642, Blast_Score=344, Evalue=9e-95,
Organism=Caenorhabditis elegans, GI212645227, Length=327, Percent_Identity=30.2752293577982, Blast_Score=144, Evalue=2e-34,
Organism=Saccharomyces cerevisiae, GI6323414, Length=847, Percent_Identity=39.1971664698937, Blast_Score=545, Evalue=1e-155,
Organism=Saccharomyces cerevisiae, GI6321531, Length=423, Percent_Identity=24.113475177305, Blast_Score=97, Evalue=8e-21,
Organism=Drosophila melanogaster, GI21355409, Length=862, Percent_Identity=32.5986078886311, Blast_Score=431, Evalue=1e-121,
Organism=Drosophila melanogaster, GI17864482, Length=453, Percent_Identity=24.5033112582781, Blast_Score=98, Evalue=3e-20,
Organism=Drosophila melanogaster, GI24653289, Length=453, Percent_Identity=24.5033112582781, Blast_Score=98, Evalue=3e-20,

Paralogues:

None

Copy number: 800 Molecules/Cell In: Glucose minimal media [C]

Swissprot (AC and ID): SYL_THETN (Q8RCT6)

Other databases:

- EMBL:   AE008691
- RefSeq:   NP_622012.1
- ProteinModelPortal:   Q8RCT6
- SMR:   Q8RCT6
- GeneID:   996294
- GenomeReviews:   AE008691_GR
- KEGG:   tte:TTE0324
- NMPDR:   fig|273068.3.peg.137
- HOGENOM:   HBG693845
- OMA:   ERGNFPV
- ProtClustDB:   PRK00390
- BioCyc:   TTEN273068:TTE0324-MONOMER
- BRENDA:   6.1.1.4
- GO:   GO:0005737
- HAMAP:   MF_00049_B
- InterPro:   IPR002300
- InterPro:   IPR002302
- InterPro:   IPR014729
- InterPro:   IPR009080
- InterPro:   IPR013155
- InterPro:   IPR009008
- Gene3D:   G3DSA:3.40.50.620
- PANTHER:   PTHR11946:SF7
- PRINTS:   PR00985
- TIGRFAMs:   TIGR00396

Pfam domain/function: PF08264 Anticodon_1; PF00133 tRNA-synt_1; SSF47323 tRNAsyn_1a_bind; SSF50677 ValRS_IleRS_edit

EC number: =6.1.1.4

Molecular weight: Translated: 95502; Mature: 95502

Theoretical pI: Translated: 5.07; Mature: 5.07

Prosite motif: PS00178 AA_TRNA_LIGASE_I

Important sites: BINDING 581-581

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.3 %Cys     (Translated Protein)
2.9 %Met     (Translated Protein)
4.3 %Cys+Met (Translated Protein)
1.3 %Cys     (Mature Protein)
2.9 %Met     (Mature Protein)
4.3 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MEDMAYSVEIDRKWQKIWEETKLYKFNPENVDKKLYCLEMFPYPSGAKLHIGHWYNYGPT
CCCCEEEEEECHHHHHHHHHCCEEEECCCCCCCEEEEEEECCCCCCCEEEECCCCCCCCC
DSWARMKRMQGYEVFHPMGFDAFGLPAENYAIKTGIHPYDSTMENIRTMERQLREMGVTF
HHHHHHHHHCCCCEECCCCCCCCCCCCCCCEEECCCCCCHHHHHHHHHHHHHHHHCCCEE
DWDYEIITCLPEYYKWTQWIFLKLYEAGLAYRKKAPVNWCPSCQTVLANEQVIDGKCERC
CCCCHHHHHCHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCHHHHHCCCCCCCCHHHHH
GTEVTKKELTQWFFKITAYAEELLEKLDDLDWPEKTKMMQRNWIGKSEGAEIEFKIDGKD
CHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHCCCCCCCCEEEEEECCCC
LSFRVFTTRADTLFGATYVVLAPEHELVDLITTEEYKEAVEEYKEYAKKQSEIERLSTEK
EEEEEEEEECCHHHCCEEEEECCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
EKTGVFTGAYAIHPLTGEKLPIWIADYVLVTYGTGCVMGVPGHDERDYEFATKYNLPIKR
HHCCEEECEEEEECCCCCCCCCHHHHEEHHEECCCEEECCCCCCCCCCEEEEECCCCHHH
VIKGVGDVDDSLPFVEYGILVNSEEFTGMTSEEARVKIVEKLKAEGKAEFKVNYRMRDWL
HHHHCCCCCCCCCCEEEEEEECCHHHCCCCCCHHHHHHHHHHHCCCCEEEEEEEHHHHHH
VSRQRYWGAPIPIIHCERCGIVPVPEEDLPVLLPYDVEFEPTGESPLKKHAGFMNVTCPK
HHHHHHCCCCCCEEEECCCCCCCCCCCCCCEEECCCCEECCCCCCHHHHHCCCEEEECCC
CGGPALRDPDTLDTFVDSSWYYLRYPDNKNDKEPFNKEWINKMLPVDKYVGGAEHATMHL
CCCCCCCCCCHHHHHHCCCEEEEECCCCCCCCCCCCHHHHHHHCCHHHHCCCCHHHHHHH
LYSRFITKVLRDLGYLNFDEPFLSLVHQGTILGPDGSRMSKSRGNVISPDDYIKQYGSDV
HHHHHHHHHHHHCCCCCCCHHHHHHHHCCCEECCCCCHHHHCCCCCCCCHHHHHHHHHHH
FRLYLMFGFSYSEGGPWSDEGIKAIARFVNRVERFIEKFIETRQNPGKTKEEMEDAEKEL
HHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHH
NYVRHYTIKHVTLDADKFEFNTAIARIMELVNALYKYENEVEVKNMKFYEDVVRDFVKIL
HHHHHEEEEEEEECCCHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHH
APFAPHFSEEMWERLGYEYSVFNQKWPEWDEKALERDMIEIAIQVNGKVRSKAQVPSNAT
HHHCCCHHHHHHHHCCCEEEECCCCCCCHHHHHHHHHHEEEEEEECCCCCCCCCCCCCCC
DEELKQIALSDERVKSYLDGKEIKKVIIVKNRLVNIVVN
HHHHHHHHCCHHHHHHHHCHHHHHHHEEEECCEEEEEEC
>Mature Secondary Structure
MEDMAYSVEIDRKWQKIWEETKLYKFNPENVDKKLYCLEMFPYPSGAKLHIGHWYNYGPT
CCCCEEEEEECHHHHHHHHHCCEEEECCCCCCCEEEEEEECCCCCCCEEEECCCCCCCCC
DSWARMKRMQGYEVFHPMGFDAFGLPAENYAIKTGIHPYDSTMENIRTMERQLREMGVTF
HHHHHHHHHCCCCEECCCCCCCCCCCCCCCEEECCCCCCHHHHHHHHHHHHHHHHCCCEE
DWDYEIITCLPEYYKWTQWIFLKLYEAGLAYRKKAPVNWCPSCQTVLANEQVIDGKCERC
CCCCHHHHHCHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCHHHHHCCCCCCCCHHHHH
GTEVTKKELTQWFFKITAYAEELLEKLDDLDWPEKTKMMQRNWIGKSEGAEIEFKIDGKD
CHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHCCCCCCCCEEEEEECCCC
LSFRVFTTRADTLFGATYVVLAPEHELVDLITTEEYKEAVEEYKEYAKKQSEIERLSTEK
EEEEEEEEECCHHHCCEEEEECCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
EKTGVFTGAYAIHPLTGEKLPIWIADYVLVTYGTGCVMGVPGHDERDYEFATKYNLPIKR
HHCCEEECEEEEECCCCCCCCCHHHHEEHHEECCCEEECCCCCCCCCCEEEEECCCCHHH
VIKGVGDVDDSLPFVEYGILVNSEEFTGMTSEEARVKIVEKLKAEGKAEFKVNYRMRDWL
HHHHCCCCCCCCCCEEEEEEECCHHHCCCCCCHHHHHHHHHHHCCCCEEEEEEEHHHHHH
VSRQRYWGAPIPIIHCERCGIVPVPEEDLPVLLPYDVEFEPTGESPLKKHAGFMNVTCPK
HHHHHHCCCCCCEEEECCCCCCCCCCCCCCEEECCCCEECCCCCCHHHHHCCCEEEECCC
CGGPALRDPDTLDTFVDSSWYYLRYPDNKNDKEPFNKEWINKMLPVDKYVGGAEHATMHL
CCCCCCCCCCHHHHHHCCCEEEEECCCCCCCCCCCCHHHHHHHCCHHHHCCCCHHHHHHH
LYSRFITKVLRDLGYLNFDEPFLSLVHQGTILGPDGSRMSKSRGNVISPDDYIKQYGSDV
HHHHHHHHHHHHCCCCCCCHHHHHHHHCCCEECCCCCHHHHCCCCCCCCHHHHHHHHHHH
FRLYLMFGFSYSEGGPWSDEGIKAIARFVNRVERFIEKFIETRQNPGKTKEEMEDAEKEL
HHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHH
NYVRHYTIKHVTLDADKFEFNTAIARIMELVNALYKYENEVEVKNMKFYEDVVRDFVKIL
HHHHHEEEEEEEECCCHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHH
APFAPHFSEEMWERLGYEYSVFNQKWPEWDEKALERDMIEIAIQVNGKVRSKAQVPSNAT
HHHCCCHHHHHHHHCCCEEEECCCCCCCHHHHHHHHHHEEEEEEECCCCCCCCCCCCCCC
DEELKQIALSDERVKSYLDGKEIKKVIIVKNRLVNIVVN
HHHHHHHHCCHHHHHHHHCHHHHHHHEEEECCEEEEEEC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 11997336