| Definition | Sulfolobus tokodaii str. 7 chromosome, complete genome. |
|---|---|
| Accession | NC_003106 |
| Length | 2,694,756 |
Click here to switch to the map view.
The map label for this gene is leuS [H]
Identifier: 15921749
GI number: 15921749
Start: 1459792
End: 1462476
Strand: Direct
Name: leuS [H]
Synonym: ST1455
Alternate gene names: 15921749
Gene position: 1459792-1462476 (Clockwise)
Preceding gene: 15921747
Following gene: 15921751
Centisome position: 54.17
GC content: 32.14
Gene sequence:
>2685_bases GTGACTTGTGATATTTACGCAAGATATATGAGAATGAAGGGTTATAACGTACTTTTCCCCATGGGATTTCATTATACTGG AACGCCGATAATTGCTATGGCTGATGATGTAGCTAAAGGAGATAAAGAGTTGATAGACATTTTCAAAAATATATATGAGA TTCCAGATAATGTAATTTCAAAATTAGCTGATCCTCTCTTTATGGCTAACTATTTCAGAGATGAAATAAAGAAGGCTATG AAAGAAATAGGTTTAAGCATTGATTGGAGAAGAGAATTTACGACTATAGACCCAGAGTTCTCATCATTCATAGTATGGCA GTTTAATAAGCTACAAGAGAAAGGATATATAGTTAGAGACACACATCCAGTTGGATGGTGTCCAGTTCACCACATTCCAG TAGGAATGCATGATACTAAAGGAGATATGGAACCTGAAATTGGCGAGTTTGTATTAATTTACTTTAATAGTGATCTAGGA ATTTTACCTGCTGCTACATTAAGACCAGAGACCGTGTTTGGTGCTATAGGAATATGGGTAAATCCGGATGTCACATATTC TATCATAGAATTAGATGGCAAAAAGATGATTGTTAGTGAAAGGGCCGCATTCAAATTAACTTTCCAATTTGATAATATAA AGAATTTAGGAAGTATAAAAGGTTCTGAATTAACTAAATATAAGGCTGTTAATCCAATAACTGGAAAAGAAATTCCTATA ATGGCAGCTGATTTTGTTGATCCTAATGTTGCTACAGGCATAGTGATGAGTGTTCCAGCCCATGCTCCTTTCGATTATTA CTATTTGAAGAAAAATAAGCAACAAGATATGCAAATAGTTTCTGTTATTCAAGTTGAAGGTCAAGGTGACACTTTAGCTA AAGATCTTGTAGAGAAGACTAATCCAAAAAACAAAGATGATCTTCAAAAATTAACTGAACAAGTTTATAGAATAGAATAT AATAAGGGTAAGATGAAAGATGTGAGCTCGCTAGTAAAACCAGAATTTGTTAACTACTTTAAGTCGTTTATTGGCTTATC AGTTCCAGAGGCAAGGCAAAAAGTAACTGAGTTCTTAATAGAGAAAGGCTTAGGTAGGAAAATTTATGAAATTATGAATA GACCGGTTTATTGTAGGTGTGGTAACGAGGTTGTAGTTAAAATACTAAAGGATCAATGGTTCTTAGACTATGGTAACCCA CAATGGAAGGCTTTAGCTAAAAAATTAATTTCTAATATGAAATTTATTCCGCCAGAGATAAGGAAAGATTTTGAGTTTGT CACAGATTGGTTACAAAAAAGGGCATGTGCTAGAACAAGAGGATTAGGTACGCCATTACCTTGGGATAAAAAATGGATTA TTGAAAGTTTAAGTGATTCCACTATCTATATGGCCTACTATACAATTTCACATAAAATAAGGCAATATCAATTAAAACCC TCTCAACTTACTTATGATTTCTGGAATTATATAATGCTAGGTATTGGAGATATTGATAAGATTTCCAGCGAAACTGGTAT ATCTAAAGAAATAATTAGGGAAATGAGGAATGAATTTCTATATTGGTATCCATTAGATATACGCCATAGTGGTAAGGATT TAATTCCTAATCATTTATCGTTCTTCATATTTAATCATGCAGCAATTTTCCCAGAAGAATTATGGCCGAAAGCTATAGCA GTCAACGGTTTTGTTTTATATGAAGGAAAGAAAATGAGTAAATCATTAAGGAACATTATCCCATTAAGAAAAGCTCTGAG AATTTATAGTCCAGACGTTGTAAGAATAGCATTGACATCTACTGCCGATATGGGTTCTGATGTAAACTTTAGTGACTCTT ATGCAAAGTCAGTAGGAGAAATATTAAGGAGGTATTACGAATTTATAAAGGAGTTACCTAAGTATGATGGTGAAGGTAGT GAATTTGCTAATAACTGGTTAAAGGCTCAAGTAAGTAGTATTGTACTCAGTTCTACTAAGAATATGGATAATATTGATTT TAGAAGTACTATTAATGATATATTATATTCATTTGATTCTTATTTAAGAGAATATATTGATATGTGTAAAGCCGATGGAA AAGAACCAAATGGAAAATTATTAAGAGAAGTAATAGAGACATGGATAAAACTATTAGCACCTTTTGCTCCTCACTTTGCT GAAGAAATTTGGCATGAATTAGGTCATACAACTTTCATCTCATTAGAGAAATGGCCTACAGCTGAAGAGTCATCTGAGGA CTTATATTATATTTTAATCCATGAATATCATAAGAGAATAATTGAGGATTCCCAGAAGATTATAAACTATTACTATAAAG GTAAGCCTAGTATCGTAAAAATATATGTTGCAGAACAAGAATTAATGAAGGTATTGAGAGAAGCTGTGCAAATACTATCT AATGGTGGTACATTAAAGCAGTTAATGGAGAAAGAGAGACCATCAGATAAAAAACTAGCTAATATAATCAGAAAGATTTA CGAACTAGCAGTAGAATTAGATGACAATATGAAAAAGTTAATCTTAGGTTATAATATTAATGAGAGAGAAATCCTTGAGT TAGGAACTAAATATATGAGTTACAAACTAGGTATACCAGTTGAAGTATATGATGTATCAAAACTAGATAAAAGTAAATAT AATAAAGAAGCCTTACCTCTTAAGCCAGCTATTATTGTTGAGTAA
Upstream 100 bases:
>100_bases CTTTGAAGCAAACCCAGATAGAACAAGGAATAAATTCTTTACGACAGTTGCCTTCCCATATCCTAATTCTCCATTTCACC TAGGTCATGGAAGAACTTAT
Downstream 100 bases:
>100_bases AACTTTTCCATTTTTTATTTCAATAACTCCAATATCTTTTAGAAAATAAATCTCTTTTCTTATATTATCTCTGCTACTAT TTGTCTTATGATATAGTATG
Product: leucyl-tRNA synthetase
Products: NA
Alternate protein names: Leucine--tRNA ligase 2; LeuRS 2 [H]
Number of amino acids: Translated: 894; Mature: 893
Protein sequence:
>894_residues MTCDIYARYMRMKGYNVLFPMGFHYTGTPIIAMADDVAKGDKELIDIFKNIYEIPDNVISKLADPLFMANYFRDEIKKAM KEIGLSIDWRREFTTIDPEFSSFIVWQFNKLQEKGYIVRDTHPVGWCPVHHIPVGMHDTKGDMEPEIGEFVLIYFNSDLG ILPAATLRPETVFGAIGIWVNPDVTYSIIELDGKKMIVSERAAFKLTFQFDNIKNLGSIKGSELTKYKAVNPITGKEIPI MAADFVDPNVATGIVMSVPAHAPFDYYYLKKNKQQDMQIVSVIQVEGQGDTLAKDLVEKTNPKNKDDLQKLTEQVYRIEY NKGKMKDVSSLVKPEFVNYFKSFIGLSVPEARQKVTEFLIEKGLGRKIYEIMNRPVYCRCGNEVVVKILKDQWFLDYGNP QWKALAKKLISNMKFIPPEIRKDFEFVTDWLQKRACARTRGLGTPLPWDKKWIIESLSDSTIYMAYYTISHKIRQYQLKP SQLTYDFWNYIMLGIGDIDKISSETGISKEIIREMRNEFLYWYPLDIRHSGKDLIPNHLSFFIFNHAAIFPEELWPKAIA VNGFVLYEGKKMSKSLRNIIPLRKALRIYSPDVVRIALTSTADMGSDVNFSDSYAKSVGEILRRYYEFIKELPKYDGEGS EFANNWLKAQVSSIVLSSTKNMDNIDFRSTINDILYSFDSYLREYIDMCKADGKEPNGKLLREVIETWIKLLAPFAPHFA EEIWHELGHTTFISLEKWPTAEESSEDLYYILIHEYHKRIIEDSQKIINYYYKGKPSIVKIYVAEQELMKVLREAVQILS NGGTLKQLMEKERPSDKKLANIIRKIYELAVELDDNMKKLILGYNINEREILELGTKYMSYKLGIPVEVYDVSKLDKSKY NKEALPLKPAIIVE
Sequences:
>Translated_894_residues MTCDIYARYMRMKGYNVLFPMGFHYTGTPIIAMADDVAKGDKELIDIFKNIYEIPDNVISKLADPLFMANYFRDEIKKAM KEIGLSIDWRREFTTIDPEFSSFIVWQFNKLQEKGYIVRDTHPVGWCPVHHIPVGMHDTKGDMEPEIGEFVLIYFNSDLG ILPAATLRPETVFGAIGIWVNPDVTYSIIELDGKKMIVSERAAFKLTFQFDNIKNLGSIKGSELTKYKAVNPITGKEIPI MAADFVDPNVATGIVMSVPAHAPFDYYYLKKNKQQDMQIVSVIQVEGQGDTLAKDLVEKTNPKNKDDLQKLTEQVYRIEY NKGKMKDVSSLVKPEFVNYFKSFIGLSVPEARQKVTEFLIEKGLGRKIYEIMNRPVYCRCGNEVVVKILKDQWFLDYGNP QWKALAKKLISNMKFIPPEIRKDFEFVTDWLQKRACARTRGLGTPLPWDKKWIIESLSDSTIYMAYYTISHKIRQYQLKP SQLTYDFWNYIMLGIGDIDKISSETGISKEIIREMRNEFLYWYPLDIRHSGKDLIPNHLSFFIFNHAAIFPEELWPKAIA VNGFVLYEGKKMSKSLRNIIPLRKALRIYSPDVVRIALTSTADMGSDVNFSDSYAKSVGEILRRYYEFIKELPKYDGEGS EFANNWLKAQVSSIVLSSTKNMDNIDFRSTINDILYSFDSYLREYIDMCKADGKEPNGKLLREVIETWIKLLAPFAPHFA EEIWHELGHTTFISLEKWPTAEESSEDLYYILIHEYHKRIIEDSQKIINYYYKGKPSIVKIYVAEQELMKVLREAVQILS NGGTLKQLMEKERPSDKKLANIIRKIYELAVELDDNMKKLILGYNINEREILELGTKYMSYKLGIPVEVYDVSKLDKSKY NKEALPLKPAIIVE >Mature_893_residues TCDIYARYMRMKGYNVLFPMGFHYTGTPIIAMADDVAKGDKELIDIFKNIYEIPDNVISKLADPLFMANYFRDEIKKAMK EIGLSIDWRREFTTIDPEFSSFIVWQFNKLQEKGYIVRDTHPVGWCPVHHIPVGMHDTKGDMEPEIGEFVLIYFNSDLGI LPAATLRPETVFGAIGIWVNPDVTYSIIELDGKKMIVSERAAFKLTFQFDNIKNLGSIKGSELTKYKAVNPITGKEIPIM AADFVDPNVATGIVMSVPAHAPFDYYYLKKNKQQDMQIVSVIQVEGQGDTLAKDLVEKTNPKNKDDLQKLTEQVYRIEYN KGKMKDVSSLVKPEFVNYFKSFIGLSVPEARQKVTEFLIEKGLGRKIYEIMNRPVYCRCGNEVVVKILKDQWFLDYGNPQ WKALAKKLISNMKFIPPEIRKDFEFVTDWLQKRACARTRGLGTPLPWDKKWIIESLSDSTIYMAYYTISHKIRQYQLKPS QLTYDFWNYIMLGIGDIDKISSETGISKEIIREMRNEFLYWYPLDIRHSGKDLIPNHLSFFIFNHAAIFPEELWPKAIAV NGFVLYEGKKMSKSLRNIIPLRKALRIYSPDVVRIALTSTADMGSDVNFSDSYAKSVGEILRRYYEFIKELPKYDGEGSE FANNWLKAQVSSIVLSSTKNMDNIDFRSTINDILYSFDSYLREYIDMCKADGKEPNGKLLREVIETWIKLLAPFAPHFAE EIWHELGHTTFISLEKWPTAEESSEDLYYILIHEYHKRIIEDSQKIINYYYKGKPSIVKIYVAEQELMKVLREAVQILSN GGTLKQLMEKERPSDKKLANIIRKIYELAVELDDNMKKLILGYNINEREILELGTKYMSYKLGIPVEVYDVSKLDKSKYN KEALPLKPAIIVE
Specific function: Unknown
COG id: COG0495
COG function: function code J; Leucyl-tRNA synthetase
Gene ontology:
Cell location: Cytoplasm [H]
Metaboloic importance: Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the class-I aminoacyl-tRNA synthetase family [H]
Homologues:
Organism=Homo sapiens, GI108773810, Length=1020, Percent_Identity=29.7058823529412, Blast_Score=378, Evalue=1e-104, Organism=Escherichia coli, GI2367096, Length=705, Percent_Identity=19.8581560283688, Blast_Score=82, Evalue=1e-16, Organism=Caenorhabditis elegans, GI17554638, Length=762, Percent_Identity=30.9711286089239, Blast_Score=352, Evalue=4e-97, Organism=Saccharomyces cerevisiae, GI6325097, Length=840, Percent_Identity=30.952380952381, Blast_Score=350, Evalue=6e-97, Organism=Drosophila melanogaster, GI28574733, Length=835, Percent_Identity=30.1796407185629, Blast_Score=359, Evalue=4e-99,
Paralogues:
None
Copy number: 2,000 Molecules/Cell In: Glucose minimal media [C]
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR002300 - InterPro: IPR020791 - InterPro: IPR004493 - InterPro: IPR014729 - InterPro: IPR009080 - InterPro: IPR013155 - InterPro: IPR009008 [H]
Pfam domain/function: PF08264 Anticodon_1; PF00133 tRNA-synt_1 [H]
EC number: =6.1.1.4 [H]
Molecular weight: Translated: 103503; Mature: 103372
Theoretical pI: Translated: 7.42; Mature: 7.42
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.7 %Cys (Translated Protein) 3.0 %Met (Translated Protein) 3.7 %Cys+Met (Translated Protein) 0.7 %Cys (Mature Protein) 2.9 %Met (Mature Protein) 3.6 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MTCDIYARYMRMKGYNVLFPMGFHYTGTPIIAMADDVAKGDKELIDIFKNIYEIPDNVIS CCHHHHHHHHHHCCCEEEEECCCCCCCCEEEEECCHHHCCHHHHHHHHHHHHHCCHHHHH KLADPLFMANYFRDEIKKAMKEIGLSIDWRREFTTIDPEFSSFIVWQFNKLQEKGYIVRD HHHHHHHHHHHHHHHHHHHHHHHCCCEEECCCCCCCCCCCCCEEEEEEHHHHHCCEEEEC THPVGWCPVHHIPVGMHDTKGDMEPEIGEFVLIYFNSDLGILPAATLRPETVFGAIGIWV CCCCCCCCCCCCCCCCCCCCCCCCCCCCCEEEEEECCCCCCCCCCCCCCCHHEEEEEEEE NPDVTYSIIELDGKKMIVSERAAFKLTFQFDNIKNLGSIKGSELTKYKAVNPITGKEIPI CCCCEEEEEEECCCEEEEECCCEEEEEEEECCCCCCCCCCCCCCHHEECCCCCCCCCCCE MAADFVDPNVATGIVMSVPAHAPFDYYYLKKNKQQDMQIVSVIQVEGQGDTLAKDLVEKT EEECCCCCCHHCCEEEECCCCCCCCEEEECCCCCHHHEEEEEEEECCCCCHHHHHHHHHC NPKNKDDLQKLTEQVYRIEYNKGKMKDVSSLVKPEFVNYFKSFIGLSVPEARQKVTEFLI CCCCHHHHHHHHHHHHEEECCCCCHHHHHHHHCHHHHHHHHHHHCCCCCHHHHHHHHHHH EKGLGRKIYEIMNRPVYCRCGNEVVVKILKDQWFLDYGNPQWKALAKKLISNMKFIPPEI HHCCCHHHHHHHCCCEEEECCHHHHHHHHHHCEEEECCCHHHHHHHHHHHHCCCCCCHHH RKDFEFVTDWLQKRACARTRGLGTPLPWDKKWIIESLSDSTIYMAYYTISHKIRQYQLKP HHHHHHHHHHHHHHHHHHHCCCCCCCCCCHHHHHHHCCCCEEEEEEEEHHHHHHHHCCCC SQLTYDFWNYIMLGIGDIDKISSETGISKEIIREMRNEFLYWYPLDIRHSGKDLIPNHLS HHHHHHHHHHHHHCCCCHHHHCCCCCCHHHHHHHHHHCEEEEEEEEECCCCCCCCCHHHH FFIFNHAAIFPEELWPKAIAVNGFVLYEGKKMSKSLRNIIPLRKALRIYSPDVVRIALTS HHHHHHHHCCCHHHCCCCEEECCEEEECCHHHHHHHHHHHHHHHHHHHCCCCEEEEEEEE TADMGSDVNFSDSYAKSVGEILRRYYEFIKELPKYDGEGSEFANNWLKAQVSSIVLSSTK CCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHCCC NMDNIDFRSTINDILYSFDSYLREYIDMCKADGKEPNGKLLREVIETWIKLLAPFAPHFA CCCCCHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHCCCHHHH EEIWHELGHTTFISLEKWPTAEESSEDLYYILIHEYHKRIIEDSQKIINYYYKGKPSIVK HHHHHHCCCCEEEEEECCCCCCCCCCCEEEEEHHHHHHHHHHHHHHHHHHHCCCCCCEEE IYVAEQELMKVLREAVQILSNGGTLKQLMEKERPSDKKLANIIRKIYELAVELDDNMKKL EEECHHHHHHHHHHHHHHHHCCCHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHCCCCEEE ILGYNINEREILELGTKYMSYKLGIPVEVYDVSKLDKSKYNKEALPLKPAIIVE EEECCCCHHHHHHHHHHHHEEECCCCEEEEECHHHHHHHCCCCCCCCCCEEEEC >Mature Secondary Structure TCDIYARYMRMKGYNVLFPMGFHYTGTPIIAMADDVAKGDKELIDIFKNIYEIPDNVIS CHHHHHHHHHHCCCEEEEECCCCCCCCEEEEECCHHHCCHHHHHHHHHHHHHCCHHHHH KLADPLFMANYFRDEIKKAMKEIGLSIDWRREFTTIDPEFSSFIVWQFNKLQEKGYIVRD HHHHHHHHHHHHHHHHHHHHHHHCCCEEECCCCCCCCCCCCCEEEEEEHHHHHCCEEEEC THPVGWCPVHHIPVGMHDTKGDMEPEIGEFVLIYFNSDLGILPAATLRPETVFGAIGIWV CCCCCCCCCCCCCCCCCCCCCCCCCCCCCEEEEEECCCCCCCCCCCCCCCHHEEEEEEEE NPDVTYSIIELDGKKMIVSERAAFKLTFQFDNIKNLGSIKGSELTKYKAVNPITGKEIPI CCCCEEEEEEECCCEEEEECCCEEEEEEEECCCCCCCCCCCCCCHHEECCCCCCCCCCCE MAADFVDPNVATGIVMSVPAHAPFDYYYLKKNKQQDMQIVSVIQVEGQGDTLAKDLVEKT EEECCCCCCHHCCEEEECCCCCCCCEEEECCCCCHHHEEEEEEEECCCCCHHHHHHHHHC NPKNKDDLQKLTEQVYRIEYNKGKMKDVSSLVKPEFVNYFKSFIGLSVPEARQKVTEFLI CCCCHHHHHHHHHHHHEEECCCCCHHHHHHHHCHHHHHHHHHHHCCCCCHHHHHHHHHHH EKGLGRKIYEIMNRPVYCRCGNEVVVKILKDQWFLDYGNPQWKALAKKLISNMKFIPPEI HHCCCHHHHHHHCCCEEEECCHHHHHHHHHHCEEEECCCHHHHHHHHHHHHCCCCCCHHH RKDFEFVTDWLQKRACARTRGLGTPLPWDKKWIIESLSDSTIYMAYYTISHKIRQYQLKP HHHHHHHHHHHHHHHHHHHCCCCCCCCCCHHHHHHHCCCCEEEEEEEEHHHHHHHHCCCC SQLTYDFWNYIMLGIGDIDKISSETGISKEIIREMRNEFLYWYPLDIRHSGKDLIPNHLS HHHHHHHHHHHHHCCCCHHHHCCCCCCHHHHHHHHHHCEEEEEEEEECCCCCCCCCHHHH FFIFNHAAIFPEELWPKAIAVNGFVLYEGKKMSKSLRNIIPLRKALRIYSPDVVRIALTS HHHHHHHHCCCHHHCCCCEEECCEEEECCHHHHHHHHHHHHHHHHHHHCCCCEEEEEEEE TADMGSDVNFSDSYAKSVGEILRRYYEFIKELPKYDGEGSEFANNWLKAQVSSIVLSSTK CCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHCCC NMDNIDFRSTINDILYSFDSYLREYIDMCKADGKEPNGKLLREVIETWIKLLAPFAPHFA CCCCCHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHCCCHHHH EEIWHELGHTTFISLEKWPTAEESSEDLYYILIHEYHKRIIEDSQKIINYYYKGKPSIVK HHHHHHCCCCEEEEEECCCCCCCCCCCEEEEEHHHHHHHHHHHHHHHHHHHCCCCCCEEE IYVAEQELMKVLREAVQILSNGGTLKQLMEKERPSDKKLANIIRKIYELAVELDDNMKKL EEECHHHHHHHHHHHHHHHHCCCHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHCCCCEEE ILGYNINEREILELGTKYMSYKLGIPVEVYDVSKLDKSKYNKEALPLKPAIIVE EEECCCCHHHHHHHHHHHHEEECCCCEEEEECHHHHHHHCCCCCCCCCCEEEEC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 11572479 [H]