| Definition | Chlamydia muridarum Nigg, complete genome. |
|---|---|
| Accession | NC_002620 |
| Length | 1,072,950 |
Click here to switch to the map view.
The map label for this gene is leuS
Identifier: 15835099
GI number: 15835099
Start: 584289
End: 586748
Strand: Reverse
Name: leuS
Synonym: TC0481
Alternate gene names: 15835099
Gene position: 586748-584289 (Counterclockwise)
Preceding gene: 15835101
Following gene: 15835098
Centisome position: 54.69
GC content: 41.75
Gene sequence:
>2460_bases ATGCGCTATGATCCCAGTCTCATAGAAGAGAAGTGGCAAAAGTTTTGGAAAGAAGAACAGACTTTTAGAGCCGAAGAGGA TGAGACTAAAACAAAATACTATGTTTTAGATATGTTCCCTTATCCATCAGGGGCGGGATTGCATGTTGGGCACTTGATTG GTTATACGGCGACAGATATTGTTGCGAGATACAAGCGTGCTAAAGGATTTTCTGTTTTGCATCCTATGGGATGGGATAGC TTTGGGCTACCTGCCGAGCAGTATGCTATACGTACAGGGACGCATCCAAGAGAAACCACGGAGAAGAATATTGCTAATTT TAAACAGCAGTTGACTTCAATGGGATTTTCCTACGATGAAAGCCGCGAATTTGCTACTTCGGATCCAGAATACTATAAAT GGACACAAAAGCTTTTTTTGATCCTTTATGAGAAAGGTCTAGCCTATATGGCTGATATGGCCGTTAACTACTGTCCTGAG TTGGGCACTGTTTTGTCTAATGAAGAAGTAGAAAATGGTTTTTCTGTTGAAGGAGGATATCCTGTTGAAAGAAGGATGCT CCGCCAGTGGGTATTACGTATAACAGCTTTTGCGGATCAGTTATTAGGTGGATTAGATGAGCTAGATTGGCCTGAAAGTG TTAAACAGCTTCAGAGAAATTGGATCGGGAAATCCGTAGGAGCATCTGTCCATTTTGAAACAGAACACGGTGTTCTGGAA GTTTTTACAACAAGACCAGATACTCTGATAGGGGTTTCTTTTTTAGTGTTGGCTCCCGAGCATCCTTTGGTTGATCTTTT AACTTCTGATGAGCAGAAAACTATTGTGGCTCAATATGTCAAGGAGACGCAAAGTAAAAGTGAAAGAGATCGCATCAGTG AAATGAAAACGAAAAGCGGGGTCTTTACTGGAGCTTATGCGAAACATCCGGTTACTCAAAATCCTATTCCTATTTGGATT GCGGATTATGTGTTAATGGGATACGGTTCAGGCGCAGTTATGGGAGTTCCTGCTCATGACGACCGAGATTTATTATTCGC GCAACAGTTCGATTTACCGATAATCTCTGTTGTTAGTGAAGATGGCGTCTGTATTAATAGTTGCCATGAGGATTTTAGTC TGGATGGGCTATCAGGAGAAGAAGCTAAGCAGTATGTGATTAACTTTTTAGAAAAGAATAATTTAGGTTCTGCAAAGGTT GCGTATAAGCTGCGAGATTGGTTGTTCTCTCGTCAACGCTATTGGGGAGAACCGATTCCAGTCATCCATTTTGAAGATGG TTCATGTCGTCCTTTAAAAGACGATGAGCTTCCTTTACTTCCCCCTGAAATCCAGGATTATCGGCCTGAGGGGGTTGGCC AGGGTCCTCTAGCCAAAGTAAAAGAATGGGTGAATGTTTTTGATTCAGAGACGCAAAAAGAAGGTAAGCGTGAAACGCAT ACCATGCCTCAGTGGGCTGGCTCTTGCTGGTACTATTTGCGTTTTTGTGATGCTCATAACTCCTGTGCTCCTTGGGCAGA GGAAAAAGAACAGTACTGGATGCCAGTAGATCTTTATATTGGAGGGGCTGAACATGCTGTGTTGCACCTGTTATACGCAC GTTTTTGGCATCAGGTATTTTATGAAGCCGGCATTGTTTCTACTCCCGAGCCATTCAAAAAATTAGTCAATCAGGGGTTA GTTTTATCAACATCCTATCGTATTCCTGGGAAAGGATATATAGCTCCCGAAATGGCTAAAGAAGAGAATGGGCAATGGAT TTCTCCTTCAGGGGAATTACTTGACGTTCGCCAAGAAAAAATGTCGAAATCTAAGTTGAATGGAGTAGATCCAAAGGTTT TGATAGATGAATTCGGAGCAGATGCGGTTCGGATGTACGCCATGTTTTCTGGACCATTAGATAAAAATAAACTCTGGTCG AACCAGGGGGTTGCTGGCTGCCGACGATTTTTAAACCGTTTTTATGAAATGGCAACTTCTTCTCGGGTAAAAGACGAGGA TATTTTTGAGGGAATGTCCTTAGCACACAAACTTGTGCAACGTGTAACGGATGACATTGAAAAATTGTCTTTGAATACGA TAACGTCTTCTTTTATGGAGTTTATCAATGAATTTGTAAAACTTCCTGTATATCCAAAAAATGCTGTAGAAATGGCTGTA CGAGCTTTAGCTCCCATTGCTCCTCATATTAGTGAAGAGTTATGGGTGTTGTTAGGGAATGCTTCGGGTATTGAAAAGGC TGGTTGGCCTAAAGCACTCCCCGAGTATTTAGAGGGGAAAATCGTGACCATCGTAGTCCAAGTAAATGGGAAGCTTCGAG CTCGATTAGATATTAGTAAGGATGCAATAGAGGAAGAGGTTGTTGCATTGGCTAAAGAAGCTGTATCTAAATATTTGGAA GGTGGGGTAGTGAGAAAGACTATTTTTGTTCTGAACCGACTAGTTAACTTCGTGATATAA
Upstream 100 bases:
>100_bases CGATCTTAAATATAGTGTATGTTTAGCGTTTATTTTTTCCTCATAGCAAGTTGGTTGTGAAGAGGAGCGTGCCAATAAAG ATAACAATAGGTTAGGTGCT
Downstream 100 bases:
>100_bases TGAGACGTTGGCTAACTTCCCGTCTTTATGATGCTTTTTTAGTTGCTGCTTTCTTAGCAGCAGCACCACGCATTTTTTAT AAAGTAGTCTTTCACGGGAA
Product: leucyl-tRNA synthetase
Products: NA
Alternate protein names: Leucine--tRNA ligase; LeuRS
Number of amino acids: Translated: 819; Mature: 819
Protein sequence:
>819_residues MRYDPSLIEEKWQKFWKEEQTFRAEEDETKTKYYVLDMFPYPSGAGLHVGHLIGYTATDIVARYKRAKGFSVLHPMGWDS FGLPAEQYAIRTGTHPRETTEKNIANFKQQLTSMGFSYDESREFATSDPEYYKWTQKLFLILYEKGLAYMADMAVNYCPE LGTVLSNEEVENGFSVEGGYPVERRMLRQWVLRITAFADQLLGGLDELDWPESVKQLQRNWIGKSVGASVHFETEHGVLE VFTTRPDTLIGVSFLVLAPEHPLVDLLTSDEQKTIVAQYVKETQSKSERDRISEMKTKSGVFTGAYAKHPVTQNPIPIWI ADYVLMGYGSGAVMGVPAHDDRDLLFAQQFDLPIISVVSEDGVCINSCHEDFSLDGLSGEEAKQYVINFLEKNNLGSAKV AYKLRDWLFSRQRYWGEPIPVIHFEDGSCRPLKDDELPLLPPEIQDYRPEGVGQGPLAKVKEWVNVFDSETQKEGKRETH TMPQWAGSCWYYLRFCDAHNSCAPWAEEKEQYWMPVDLYIGGAEHAVLHLLYARFWHQVFYEAGIVSTPEPFKKLVNQGL VLSTSYRIPGKGYIAPEMAKEENGQWISPSGELLDVRQEKMSKSKLNGVDPKVLIDEFGADAVRMYAMFSGPLDKNKLWS NQGVAGCRRFLNRFYEMATSSRVKDEDIFEGMSLAHKLVQRVTDDIEKLSLNTITSSFMEFINEFVKLPVYPKNAVEMAV RALAPIAPHISEELWVLLGNASGIEKAGWPKALPEYLEGKIVTIVVQVNGKLRARLDISKDAIEEEVVALAKEAVSKYLE GGVVRKTIFVLNRLVNFVI
Sequences:
>Translated_819_residues MRYDPSLIEEKWQKFWKEEQTFRAEEDETKTKYYVLDMFPYPSGAGLHVGHLIGYTATDIVARYKRAKGFSVLHPMGWDS FGLPAEQYAIRTGTHPRETTEKNIANFKQQLTSMGFSYDESREFATSDPEYYKWTQKLFLILYEKGLAYMADMAVNYCPE LGTVLSNEEVENGFSVEGGYPVERRMLRQWVLRITAFADQLLGGLDELDWPESVKQLQRNWIGKSVGASVHFETEHGVLE VFTTRPDTLIGVSFLVLAPEHPLVDLLTSDEQKTIVAQYVKETQSKSERDRISEMKTKSGVFTGAYAKHPVTQNPIPIWI ADYVLMGYGSGAVMGVPAHDDRDLLFAQQFDLPIISVVSEDGVCINSCHEDFSLDGLSGEEAKQYVINFLEKNNLGSAKV AYKLRDWLFSRQRYWGEPIPVIHFEDGSCRPLKDDELPLLPPEIQDYRPEGVGQGPLAKVKEWVNVFDSETQKEGKRETH TMPQWAGSCWYYLRFCDAHNSCAPWAEEKEQYWMPVDLYIGGAEHAVLHLLYARFWHQVFYEAGIVSTPEPFKKLVNQGL VLSTSYRIPGKGYIAPEMAKEENGQWISPSGELLDVRQEKMSKSKLNGVDPKVLIDEFGADAVRMYAMFSGPLDKNKLWS NQGVAGCRRFLNRFYEMATSSRVKDEDIFEGMSLAHKLVQRVTDDIEKLSLNTITSSFMEFINEFVKLPVYPKNAVEMAV RALAPIAPHISEELWVLLGNASGIEKAGWPKALPEYLEGKIVTIVVQVNGKLRARLDISKDAIEEEVVALAKEAVSKYLE GGVVRKTIFVLNRLVNFVI >Mature_819_residues MRYDPSLIEEKWQKFWKEEQTFRAEEDETKTKYYVLDMFPYPSGAGLHVGHLIGYTATDIVARYKRAKGFSVLHPMGWDS FGLPAEQYAIRTGTHPRETTEKNIANFKQQLTSMGFSYDESREFATSDPEYYKWTQKLFLILYEKGLAYMADMAVNYCPE LGTVLSNEEVENGFSVEGGYPVERRMLRQWVLRITAFADQLLGGLDELDWPESVKQLQRNWIGKSVGASVHFETEHGVLE VFTTRPDTLIGVSFLVLAPEHPLVDLLTSDEQKTIVAQYVKETQSKSERDRISEMKTKSGVFTGAYAKHPVTQNPIPIWI ADYVLMGYGSGAVMGVPAHDDRDLLFAQQFDLPIISVVSEDGVCINSCHEDFSLDGLSGEEAKQYVINFLEKNNLGSAKV AYKLRDWLFSRQRYWGEPIPVIHFEDGSCRPLKDDELPLLPPEIQDYRPEGVGQGPLAKVKEWVNVFDSETQKEGKRETH TMPQWAGSCWYYLRFCDAHNSCAPWAEEKEQYWMPVDLYIGGAEHAVLHLLYARFWHQVFYEAGIVSTPEPFKKLVNQGL VLSTSYRIPGKGYIAPEMAKEENGQWISPSGELLDVRQEKMSKSKLNGVDPKVLIDEFGADAVRMYAMFSGPLDKNKLWS NQGVAGCRRFLNRFYEMATSSRVKDEDIFEGMSLAHKLVQRVTDDIEKLSLNTITSSFMEFINEFVKLPVYPKNAVEMAV RALAPIAPHISEELWVLLGNASGIEKAGWPKALPEYLEGKIVTIVVQVNGKLRARLDISKDAIEEEVVALAKEAVSKYLE GGVVRKTIFVLNRLVNFVI
Specific function: Unknown
COG id: COG0495
COG function: function code J; Leucyl-tRNA synthetase
Gene ontology:
Cell location: Cytoplasm
Metaboloic importance: Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the class-I aminoacyl-tRNA synthetase family
Homologues:
Organism=Homo sapiens, GI7661872, Length=867, Percent_Identity=32.8719723183391, Blast_Score=454, Evalue=1e-127, Organism=Homo sapiens, GI94721239, Length=200, Percent_Identity=27.5, Blast_Score=69, Evalue=2e-11, Organism=Homo sapiens, GI94721241, Length=200, Percent_Identity=27.5, Blast_Score=69, Evalue=2e-11, Organism=Escherichia coli, GI1786861, Length=870, Percent_Identity=40.6896551724138, Blast_Score=619, Evalue=1e-178, Organism=Escherichia coli, GI1790708, Length=378, Percent_Identity=25.1322751322751, Blast_Score=88, Evalue=2e-18, Organism=Caenorhabditis elegans, GI71997517, Length=838, Percent_Identity=28.4009546539379, Blast_Score=284, Evalue=1e-76, Organism=Caenorhabditis elegans, GI71997510, Length=841, Percent_Identity=28.2996432818074, Blast_Score=284, Evalue=1e-76, Organism=Caenorhabditis elegans, GI212645227, Length=339, Percent_Identity=27.7286135693215, Blast_Score=116, Evalue=6e-26, Organism=Saccharomyces cerevisiae, GI6323414, Length=886, Percent_Identity=35.5530474040632, Blast_Score=468, Evalue=1e-132, Organism=Saccharomyces cerevisiae, GI6321531, Length=418, Percent_Identity=26.3157894736842, Blast_Score=105, Evalue=2e-23, Organism=Drosophila melanogaster, GI21355409, Length=865, Percent_Identity=32.1387283236994, Blast_Score=405, Evalue=1e-113, Organism=Drosophila melanogaster, GI17864482, Length=417, Percent_Identity=23.5011990407674, Blast_Score=94, Evalue=5e-19, Organism=Drosophila melanogaster, GI24653289, Length=417, Percent_Identity=23.5011990407674, Blast_Score=94, Evalue=5e-19,
Paralogues:
None
Copy number: 800 Molecules/Cell In: Glucose minimal media [C]
Swissprot (AC and ID): SYL_CHLMU (Q9PKI4)
Other databases:
- EMBL: AE002160 - PIR: G81698 - RefSeq: NP_296858.1 - ProteinModelPortal: Q9PKI4 - SMR: Q9PKI4 - GeneID: 1245839 - GenomeReviews: AE002160_GR - KEGG: cmu:TC0481 - TIGR: TC_0481 - HOGENOM: HBG693845 - OMA: ERGNFPV - ProtClustDB: PRK00390 - BioCyc: CMUR243161:TC_0481-MONOMER - BRENDA: 6.1.1.4 - GO: GO:0005737 - HAMAP: MF_00049_B - InterPro: IPR001412 - InterPro: IPR002300 - InterPro: IPR002302 - InterPro: IPR014729 - InterPro: IPR009080 - InterPro: IPR013155 - InterPro: IPR009008 - Gene3D: G3DSA:3.40.50.620 - PANTHER: PTHR11946:SF7 - PRINTS: PR00985 - TIGRFAMs: TIGR00396
Pfam domain/function: PF08264 Anticodon_1; PF00133 tRNA-synt_1; SSF47323 tRNAsyn_1a_bind; SSF50677 ValRS_IleRS_edit
EC number: =6.1.1.4
Molecular weight: Translated: 93016; Mature: 93016
Theoretical pI: Translated: 5.17; Mature: 5.17
Prosite motif: PS00178 AA_TRNA_LIGASE_I
Important sites: BINDING 603-603
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.0 %Cys (Translated Protein) 2.4 %Met (Translated Protein) 3.4 %Cys+Met (Translated Protein) 1.0 %Cys (Mature Protein) 2.4 %Met (Mature Protein) 3.4 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MRYDPSLIEEKWQKFWKEEQTFRAEEDETKTKYYVLDMFPYPSGAGLHVGHLIGYTATDI CCCCHHHHHHHHHHHHHHHHHHCCCCCCCCCEEEEEEECCCCCCCCCHHHHHHHHHHHHH VARYKRAKGFSVLHPMGWDSFGLPAEQYAIRTGTHPRETTEKNIANFKQQLTSMGFSYDE HHHHHHCCCCEEECCCCCCCCCCCHHHHEEECCCCCCHHHHHHHHHHHHHHHHCCCCCCC SREFATSDPEYYKWTQKLFLILYEKGLAYMADMAVNYCPELGTVLSNEEVENGFSVEGGY CCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHCHHHHHHHCCCHHCCCCCCCCCC PVERRMLRQWVLRITAFADQLLGGLDELDWPESVKQLQRNWIGKSVGASVHFETEHGVLE CHHHHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHCCHHCCCEEEEECCCCEEE VFTTRPDTLIGVSFLVLAPEHPLVDLLTSDEQKTIVAQYVKETQSKSERDRISEMKTKSG EEECCCCHHHCCEEEEECCCCCHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCC VFTGAYAKHPVTQNPIPIWIADYVLMGYGSGAVMGVPAHDDRDLLFAQQFDLPIISVVSE CEECCCCCCCCCCCCCCHHHHHHHHHCCCCCCEEECCCCCCCCEEEHHHCCCCEEEEECC DGVCINSCHEDFSLDGLSGEEAKQYVINFLEKNNLGSAKVAYKLRDWLFSRQRYWGEPIP CCCCHHCCCCCCCCCCCCHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHCCCCCC VIHFEDGSCRPLKDDELPLLPPEIQDYRPEGVGQGPLAKVKEWVNVFDSETQKEGKRETH EEEECCCCCCCCCCCCCCCCCCCHHCCCCCCCCCCCHHHHHHHHHHHCCHHHHHCCHHHC TMPQWAGSCWYYLRFCDAHNSCAPWAEEKEQYWMPVDLYIGGAEHAVLHLLYARFWHQVF CCCHHHCCCEEEEEEECCCCCCCCCCHHHHCEECEEEEEECCHHHHHHHHHHHHHHHHHH YEAGIVSTPEPFKKLVNQGLVLSTSYRIPGKGYIAPEMAKEENGQWISPSGELLDVRQEK HHCCCCCCCHHHHHHHHCCEEEEECCCCCCCCCCCCHHHHCCCCCEECCCCCHHHHHHHH MSKSKLNGVDPKVLIDEFGADAVRMYAMFSGPLDKNKLWSNQGVAGCRRFLNRFYEMATS HHHHHCCCCCHHHHHHHHCCHHHHHHHHHCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHC SRVKDEDIFEGMSLAHKLVQRVTDDIEKLSLNTITSSFMEFINEFVKLPVYPKNAVEMAV CCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHH RALAPIAPHISEELWVLLGNASGIEKAGWPKALPEYLEGKIVTIVVQVNGKLRARLDISK HHHHHHCCCCCCCEEEEEECCCCCCCCCCCHHHHHHHCCEEEEEEEEECCCEEEEECCCH DAIEEEVVALAKEAVSKYLEGGVVRKTIFVLNRLVNFVI HHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHCC >Mature Secondary Structure MRYDPSLIEEKWQKFWKEEQTFRAEEDETKTKYYVLDMFPYPSGAGLHVGHLIGYTATDI CCCCHHHHHHHHHHHHHHHHHHCCCCCCCCCEEEEEEECCCCCCCCCHHHHHHHHHHHHH VARYKRAKGFSVLHPMGWDSFGLPAEQYAIRTGTHPRETTEKNIANFKQQLTSMGFSYDE HHHHHHCCCCEEECCCCCCCCCCCHHHHEEECCCCCCHHHHHHHHHHHHHHHHCCCCCCC SREFATSDPEYYKWTQKLFLILYEKGLAYMADMAVNYCPELGTVLSNEEVENGFSVEGGY CCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHCHHHHHHHCCCHHCCCCCCCCCC PVERRMLRQWVLRITAFADQLLGGLDELDWPESVKQLQRNWIGKSVGASVHFETEHGVLE CHHHHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHCCHHCCCEEEEECCCCEEE VFTTRPDTLIGVSFLVLAPEHPLVDLLTSDEQKTIVAQYVKETQSKSERDRISEMKTKSG EEECCCCHHHCCEEEEECCCCCHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCC VFTGAYAKHPVTQNPIPIWIADYVLMGYGSGAVMGVPAHDDRDLLFAQQFDLPIISVVSE CEECCCCCCCCCCCCCCHHHHHHHHHCCCCCCEEECCCCCCCCEEEHHHCCCCEEEEECC DGVCINSCHEDFSLDGLSGEEAKQYVINFLEKNNLGSAKVAYKLRDWLFSRQRYWGEPIP CCCCHHCCCCCCCCCCCCHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHCCCCCC VIHFEDGSCRPLKDDELPLLPPEIQDYRPEGVGQGPLAKVKEWVNVFDSETQKEGKRETH EEEECCCCCCCCCCCCCCCCCCCHHCCCCCCCCCCCHHHHHHHHHHHCCHHHHHCCHHHC TMPQWAGSCWYYLRFCDAHNSCAPWAEEKEQYWMPVDLYIGGAEHAVLHLLYARFWHQVF CCCHHHCCCEEEEEEECCCCCCCCCCHHHHCEECEEEEEECCHHHHHHHHHHHHHHHHHH YEAGIVSTPEPFKKLVNQGLVLSTSYRIPGKGYIAPEMAKEENGQWISPSGELLDVRQEK HHCCCCCCCHHHHHHHHCCEEEEECCCCCCCCCCCCHHHHCCCCCEECCCCCHHHHHHHH MSKSKLNGVDPKVLIDEFGADAVRMYAMFSGPLDKNKLWSNQGVAGCRRFLNRFYEMATS HHHHHCCCCCHHHHHHHHCCHHHHHHHHHCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHC SRVKDEDIFEGMSLAHKLVQRVTDDIEKLSLNTITSSFMEFINEFVKLPVYPKNAVEMAV CCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHH RALAPIAPHISEELWVLLGNASGIEKAGWPKALPEYLEGKIVTIVVQVNGKLRARLDISK HHHHHHCCCCCCCEEEEEECCCCCCCCCCCHHHHHHHCCEEEEEEEEECCCEEEEECCCH DAIEEEVVALAKEAVSKYLEGGVVRKTIFVLNRLVNFVI HHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 10684935