| Definition | Ehrlichia chaffeensis str. Arkansas, complete genome. |
|---|---|
| Accession | NC_007799 |
| Length | 1,176,248 |
Click here to switch to the map view.
The map label for this gene is leuS
Identifier: 88658156
GI number: 88658156
Start: 809295
End: 811784
Strand: Reverse
Name: leuS
Synonym: ECH_0794
Alternate gene names: 88658156
Gene position: 811784-809295 (Counterclockwise)
Preceding gene: 88658451
Following gene: 88658121
Centisome position: 69.01
GC content: 32.13
Gene sequence:
>2490_bases ATGCATTATGATTTCAAAAAAGTAGAACAAGATATACAAGGAAAATGGAATTTTTATACTGATGCAAAACAAGCTCAGTG CTACGTTTTAGAGATGTTTCCTTATCCTTCTGGTAACATACATATGGGTCACTTGAGGAATTATACTATAGGTGATGTTA TTGCGAGATATAAACGTGCTTGTGGTATTAATGTCTTTCATCCGATAGGATGGGATGCTTTTGGATTACCAGCAGAAAAT GCTGCTTTATCTTATAATATAAATCCACATACTTGGACTGAAAGCAATATTGATAATATGAGATGTCAGTTGAAATCTAT AGGATTATCCTATGATTGGGATAAGGAATTAGCTACTTGTGATCCAAGTTATTATAAACATGAACAAGCATTTTTTCTTG ATTTTCTAAAGTGTGGTTTAGCTTATCGCAAAGAGTCATTGGTAAATTGGGATCCTGTGGATCAAACTGTGCTTGCTAAT GAACAAGTTATAGATGGAAGGGGATGGCGTTCTGGAGCTGTGGTAGAAAAAAGAAAATTATTTCAATGGTTTCTAAAGAT TACTGATTTTGCAGAAGAGTTATTGAATGACTTACAAATCTTAGATCAGTGGCCAGAGAAAGTAAAGTTGATGCAAGAAA AATGGATTGGTAAGTCTCAGGGTGTAGTAATAGATTTTGAAATTTTAGGTATTAATAAAACGTTACAAGTTTTTACTACA TGTCCCCATACATTGTTTGGAGCAGCATTTATTGCAGTATCTTTTGATCATCCGATTTTACAATATGTTAATGATTCAAA AGTAATTCAATTGATAAATGATTTTGACAGAAAAAATTTAATCAGTGATGTATCTAGTACAATAGAAAAATTTGGAATAG ATTCTGGATTAGTTGTAAAACATCCTTTGTTAAATGTAAATTTACCAGTTTATATTGTAAATTTTGTCTTAATGGATTAT GCAACGGGGGCAATTTTTGGTTGTCCAGCACATGATCAGCGTGATTTTGAATTTGCAAAGAAATATTCCTTGCCAGTAAA GCAAGTGGTATTTCCTGAAGTTGATGTGAACTTAGATAAAGAAGCTTATGTTGGCTCAGGTATTATGAAACACTCTGATT TTTTAGATGGTATGACTGTAGATGAAGCTAAAAAAGCTATAGTTGCAAAGCTTACATTTTTAGGGGTGTGCAAAGAAATA ACATATTATAGAATGCATGATTGGGGGATATCTAGACAACGTTATTGGGGGTGTCCTATACCGATAATATATTGTAAAAA ATGTGGTACGGTTCCTGTAGATAAAAAAGATTTACCAGTAACTTTACCTAAAGATGTTGATTTTACAAAATATGGTAATC CTTTAGACAATCATCCTACTTGGAAATATGTAAAATGTCCATCTTGTGGTATGGATGCTGAACGTGAGACTGATACTTTT GACACTTTTTTTGAATCTTCTTGGTATTTTGCAGCATTTTGTGGAACTAGCAATGGAATAAATAAGGATGTGTGTAACAT GTTATTACCAGTCAATTATTATGTAGGTGGGGTAGAACATGCAGTATTGCATTTGTTGTATTCTAGATTCTTCTGTCGAG CATTAACTAAGTGTGGATATTTTAATATTAAGGAACCTTTTTCTAATTTGATAACGCAAGGTATGGTTTGTCATTCTACT TATTCGGATGAGCAGGGTAATTACTTATTTCCTGAAGAAGCAAAAAAAATGATGGAAAATGGTCAGCATGTTACTGTTGG TAGAGCTGAGAAGATGAGTAAGTCGAAAAAAAATGTGGTGAATCTTGAATATATTATTGATAAGTACGGAGCAGATACAG CAAGATTATTTATATTGTCAGATACTCCTCCTGAGCGTGATATAGAATGGCTAGATGATGGTATAGAGGGGGCAAGTAGG TATCTTAGTAAATTATGGAGGGTAATAATTTCTTATGATAAGTTTAATTTAAATTTTAACAAAGAAAATATAATAGGAGA TGATGTTAAATATAGAAGATCTGTGCATAAAATTTTAAGTGGCATTACAAATGATTTAGATTTTTGCCGTTTAAATTGTG CTGTAGCTAAGTTTAGGGAATTAAGCAATATCATTAGTGAAATGATAAGAACTTCAGTAAATTGTTATGTAGTGAGTGAA GCAATATATATTCTAATTAGAGTAATAGAACCTTTTATTCCACATATAGCTGAAAAATTATGGGAAAATATAGGGGGTAA AGGTATGTTATGGAATCAGGTATGGCCTAAAGCAGATTCAGAGCTACTTGTTGAAAGAAATGTTACAATTGTGGTGCAGG TTAATGGTAAATTTGTGAAAGCATTAACAGTTGCTAATGATATTGATGATGATCAACTTAAATCTATGGCTTTGGAAATA GCTAAGAATAGAATAGGTGGCAATGTTGTAAAAGATATATATGTTATTCCAAAACGAGTAATAAATATCGTTGCTGTCAA ACCGAGCTAA
Upstream 100 bases:
>100_bases TGGTATGTGTATATTTTGTATTGCTTGAATTATCTGATAATGTACTGTACAACAACTAAGCTGAAATAGTTTTTAATGGA ATTTTTATCAACGGTGTACC
Downstream 100 bases:
>100_bases AAATTTGATAATCTGATGTATAAGTTTTTGTAGATAGCTTTTTCATTTCAAGATTATGAGTAGTAACTAATCTTTTTGGT GGGTTTGTTTAGTATAGTAT
Product: leucyl-tRNA synthetase
Products: NA
Alternate protein names: Leucine--tRNA ligase; LeuRS
Number of amino acids: Translated: 829; Mature: 829
Protein sequence:
>829_residues MHYDFKKVEQDIQGKWNFYTDAKQAQCYVLEMFPYPSGNIHMGHLRNYTIGDVIARYKRACGINVFHPIGWDAFGLPAEN AALSYNINPHTWTESNIDNMRCQLKSIGLSYDWDKELATCDPSYYKHEQAFFLDFLKCGLAYRKESLVNWDPVDQTVLAN EQVIDGRGWRSGAVVEKRKLFQWFLKITDFAEELLNDLQILDQWPEKVKLMQEKWIGKSQGVVIDFEILGINKTLQVFTT CPHTLFGAAFIAVSFDHPILQYVNDSKVIQLINDFDRKNLISDVSSTIEKFGIDSGLVVKHPLLNVNLPVYIVNFVLMDY ATGAIFGCPAHDQRDFEFAKKYSLPVKQVVFPEVDVNLDKEAYVGSGIMKHSDFLDGMTVDEAKKAIVAKLTFLGVCKEI TYYRMHDWGISRQRYWGCPIPIIYCKKCGTVPVDKKDLPVTLPKDVDFTKYGNPLDNHPTWKYVKCPSCGMDAERETDTF DTFFESSWYFAAFCGTSNGINKDVCNMLLPVNYYVGGVEHAVLHLLYSRFFCRALTKCGYFNIKEPFSNLITQGMVCHST YSDEQGNYLFPEEAKKMMENGQHVTVGRAEKMSKSKKNVVNLEYIIDKYGADTARLFILSDTPPERDIEWLDDGIEGASR YLSKLWRVIISYDKFNLNFNKENIIGDDVKYRRSVHKILSGITNDLDFCRLNCAVAKFRELSNIISEMIRTSVNCYVVSE AIYILIRVIEPFIPHIAEKLWENIGGKGMLWNQVWPKADSELLVERNVTIVVQVNGKFVKALTVANDIDDDQLKSMALEI AKNRIGGNVVKDIYVIPKRVINIVAVKPS
Sequences:
>Translated_829_residues MHYDFKKVEQDIQGKWNFYTDAKQAQCYVLEMFPYPSGNIHMGHLRNYTIGDVIARYKRACGINVFHPIGWDAFGLPAEN AALSYNINPHTWTESNIDNMRCQLKSIGLSYDWDKELATCDPSYYKHEQAFFLDFLKCGLAYRKESLVNWDPVDQTVLAN EQVIDGRGWRSGAVVEKRKLFQWFLKITDFAEELLNDLQILDQWPEKVKLMQEKWIGKSQGVVIDFEILGINKTLQVFTT CPHTLFGAAFIAVSFDHPILQYVNDSKVIQLINDFDRKNLISDVSSTIEKFGIDSGLVVKHPLLNVNLPVYIVNFVLMDY ATGAIFGCPAHDQRDFEFAKKYSLPVKQVVFPEVDVNLDKEAYVGSGIMKHSDFLDGMTVDEAKKAIVAKLTFLGVCKEI TYYRMHDWGISRQRYWGCPIPIIYCKKCGTVPVDKKDLPVTLPKDVDFTKYGNPLDNHPTWKYVKCPSCGMDAERETDTF DTFFESSWYFAAFCGTSNGINKDVCNMLLPVNYYVGGVEHAVLHLLYSRFFCRALTKCGYFNIKEPFSNLITQGMVCHST YSDEQGNYLFPEEAKKMMENGQHVTVGRAEKMSKSKKNVVNLEYIIDKYGADTARLFILSDTPPERDIEWLDDGIEGASR YLSKLWRVIISYDKFNLNFNKENIIGDDVKYRRSVHKILSGITNDLDFCRLNCAVAKFRELSNIISEMIRTSVNCYVVSE AIYILIRVIEPFIPHIAEKLWENIGGKGMLWNQVWPKADSELLVERNVTIVVQVNGKFVKALTVANDIDDDQLKSMALEI AKNRIGGNVVKDIYVIPKRVINIVAVKPS >Mature_829_residues MHYDFKKVEQDIQGKWNFYTDAKQAQCYVLEMFPYPSGNIHMGHLRNYTIGDVIARYKRACGINVFHPIGWDAFGLPAEN AALSYNINPHTWTESNIDNMRCQLKSIGLSYDWDKELATCDPSYYKHEQAFFLDFLKCGLAYRKESLVNWDPVDQTVLAN EQVIDGRGWRSGAVVEKRKLFQWFLKITDFAEELLNDLQILDQWPEKVKLMQEKWIGKSQGVVIDFEILGINKTLQVFTT CPHTLFGAAFIAVSFDHPILQYVNDSKVIQLINDFDRKNLISDVSSTIEKFGIDSGLVVKHPLLNVNLPVYIVNFVLMDY ATGAIFGCPAHDQRDFEFAKKYSLPVKQVVFPEVDVNLDKEAYVGSGIMKHSDFLDGMTVDEAKKAIVAKLTFLGVCKEI TYYRMHDWGISRQRYWGCPIPIIYCKKCGTVPVDKKDLPVTLPKDVDFTKYGNPLDNHPTWKYVKCPSCGMDAERETDTF DTFFESSWYFAAFCGTSNGINKDVCNMLLPVNYYVGGVEHAVLHLLYSRFFCRALTKCGYFNIKEPFSNLITQGMVCHST YSDEQGNYLFPEEAKKMMENGQHVTVGRAEKMSKSKKNVVNLEYIIDKYGADTARLFILSDTPPERDIEWLDDGIEGASR YLSKLWRVIISYDKFNLNFNKENIIGDDVKYRRSVHKILSGITNDLDFCRLNCAVAKFRELSNIISEMIRTSVNCYVVSE AIYILIRVIEPFIPHIAEKLWENIGGKGMLWNQVWPKADSELLVERNVTIVVQVNGKFVKALTVANDIDDDQLKSMALEI AKNRIGGNVVKDIYVIPKRVINIVAVKPS
Specific function: Unknown
COG id: COG0495
COG function: function code J; Leucyl-tRNA synthetase
Gene ontology:
Cell location: Cytoplasm
Metaboloic importance: Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the class-I aminoacyl-tRNA synthetase family
Homologues:
Organism=Homo sapiens, GI7661872, Length=846, Percent_Identity=34.7517730496454, Blast_Score=488, Evalue=1e-138, Organism=Escherichia coli, GI1786861, Length=858, Percent_Identity=40.9090909090909, Blast_Score=667, Evalue=0.0, Organism=Escherichia coli, GI1790708, Length=388, Percent_Identity=23.4536082474227, Blast_Score=85, Evalue=2e-17, Organism=Caenorhabditis elegans, GI71997510, Length=196, Percent_Identity=48.9795918367347, Blast_Score=207, Evalue=2e-53, Organism=Caenorhabditis elegans, GI71997517, Length=196, Percent_Identity=48.9795918367347, Blast_Score=207, Evalue=3e-53, Organism=Caenorhabditis elegans, GI212645227, Length=307, Percent_Identity=28.6644951140065, Blast_Score=125, Evalue=1e-28, Organism=Saccharomyces cerevisiae, GI6323414, Length=792, Percent_Identity=40.1515151515151, Blast_Score=528, Evalue=1e-150, Organism=Drosophila melanogaster, GI21355409, Length=843, Percent_Identity=34.0450771055753, Blast_Score=436, Evalue=1e-122,
Paralogues:
None
Copy number: 800 Molecules/Cell In: Glucose minimal media [C]
Swissprot (AC and ID): SYL_EHRCR (Q2GG41)
Other databases:
- EMBL: CP000236 - RefSeq: YP_507592.1 - ProteinModelPortal: Q2GG41 - SMR: Q2GG41 - STRING: Q2GG41 - GeneID: 3927180 - GenomeReviews: CP000236_GR - KEGG: ech:ECH_0794 - TIGR: ECH_0794 - eggNOG: COG0495 - HOGENOM: HBG693845 - OMA: YARYCSP - PhylomeDB: Q2GG41 - ProtClustDB: PRK00390 - BioCyc: ECHA205920:ECH_0794-MONOMER - GO: GO:0005737 - HAMAP: MF_00049_B - InterPro: IPR001412 - InterPro: IPR002300 - InterPro: IPR002302 - InterPro: IPR014729 - InterPro: IPR009080 - InterPro: IPR013155 - InterPro: IPR009008 - Gene3D: G3DSA:3.40.50.620 - PANTHER: PTHR11946:SF7 - PRINTS: PR00985 - TIGRFAMs: TIGR00396
Pfam domain/function: PF08264 Anticodon_1; PF00133 tRNA-synt_1; SSF47323 tRNAsyn_1a_bind; SSF50677 ValRS_IleRS_edit
EC number: =6.1.1.4
Molecular weight: Translated: 94869; Mature: 94869
Theoretical pI: Translated: 6.63; Mature: 6.63
Prosite motif: PS00178 AA_TRNA_LIGASE_I; PS00073 ACYL_COA_DH_2
Important sites: BINDING 594-594
Signals:
None
Transmembrane regions:
None
Cys/Met content:
2.5 %Cys (Translated Protein) 2.2 %Met (Translated Protein) 4.7 %Cys+Met (Translated Protein) 2.5 %Cys (Mature Protein) 2.2 %Met (Mature Protein) 4.7 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MHYDFKKVEQDIQGKWNFYTDAKQAQCYVLEMFPYPSGNIHMGHLRNYTIGDVIARYKRA CCCCHHHHHHHHCCCCCEECCCCCCEEEEEEEECCCCCCEEECCCCCCCHHHHHHHHHHH CGINVFHPIGWDAFGLPAENAALSYNINPHTWTESNIDNMRCQLKSIGLSYDWDKELATC CCCCEECCCCCCCCCCCCCCCEEEEECCCCCCCCCCCHHHHHHHHHCCCCCCCCCCHHCC DPSYYKHEQAFFLDFLKCGLAYRKESLVNWDPVDQTVLANEQVIDGRGWRSGAVVEKRKL CCHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCHHHCCCEEECCCCCCCCCHHHHHHH FQWFLKITDFAEELLNDLQILDQWPEKVKLMQEKWIGKSQGVVIDFEILGINKTLQVFTT HHHHHHHHHHHHHHHHHHHHHHHCHHHHHHHHHHCCCCCCCEEEEEEEECCCCHHHHHHC CPHTLFGAAFIAVSFDHPILQYVNDSKVIQLINDFDRKNLISDVSSTIEKFGIDSGLVVK CCHHHHHHHHEEEECCCHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCEEE HPLLNVNLPVYIVNFVLMDYATGAIFGCPAHDQRDFEFAKKYSLPVKQVVFPEVDVNLDK CCCEECCCHHHHHHHHHHHHCCCCEEECCCCCCCCHHHHHHHCCCHHHHCCCCCCCCCCC EAYVGSGIMKHSDFLDGMTVDEAKKAIVAKLTFLGVCKEITYYRMHDWGISRQRYWGCPI HHHHCCCHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHEEEECCCCCCCCCCCCCC PIIYCKKCGTVPVDKKDLPVTLPKDVDFTKYGNPLDNHPTWKYVKCPSCGMDAERETDTF CEEEECCCCCCCCCCCCCCEECCCCCCHHHCCCCCCCCCCEEEEECCCCCCCCCCCCCHH DTFFESSWYFAAFCGTSNGINKDVCNMLLPVNYYVGGVEHAVLHLLYSRFFCRALTKCGY HHHHCCCCEEEEEECCCCCCCHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHCCC FNIKEPFSNLITQGMVCHSTYSDEQGNYLFPEEAKKMMENGQHVTVGRAEKMSKSKKNVV CCCHHHHHHHHHCCEEEECCCCCCCCCEECHHHHHHHHHCCCEEEECCHHHHHHHHCCEE NLEYIIDKYGADTARLFILSDTPPERDIEWLDDGIEGASRYLSKLWRVIISYDKFNLNFN EHHHHHHHCCCCEEEEEEEECCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHEEECCC KENIIGDDVKYRRSVHKILSGITNDLDFCRLNCAVAKFRELSNIISEMIRTSVNCYVVSE CCCCCCCHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEHHH AIYILIRVIEPFIPHIAEKLWENIGGKGMLWNQVWPKADSELLVERNVTIVVQVNGKFVK HHHHHHHHHHHHHHHHHHHHHHHCCCCCEEECCCCCCCCCCEEEECCCEEEEEECCCEEE ALTVANDIDDDQLKSMALEIAKNRIGGNVVKDIYVIPKRVINIVAVKPS EEEECCCCCHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHEEEEEECCC >Mature Secondary Structure MHYDFKKVEQDIQGKWNFYTDAKQAQCYVLEMFPYPSGNIHMGHLRNYTIGDVIARYKRA CCCCHHHHHHHHCCCCCEECCCCCCEEEEEEEECCCCCCEEECCCCCCCHHHHHHHHHHH CGINVFHPIGWDAFGLPAENAALSYNINPHTWTESNIDNMRCQLKSIGLSYDWDKELATC CCCCEECCCCCCCCCCCCCCCEEEEECCCCCCCCCCCHHHHHHHHHCCCCCCCCCCHHCC DPSYYKHEQAFFLDFLKCGLAYRKESLVNWDPVDQTVLANEQVIDGRGWRSGAVVEKRKL CCHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCHHHCCCEEECCCCCCCCCHHHHHHH FQWFLKITDFAEELLNDLQILDQWPEKVKLMQEKWIGKSQGVVIDFEILGINKTLQVFTT HHHHHHHHHHHHHHHHHHHHHHHCHHHHHHHHHHCCCCCCCEEEEEEEECCCCHHHHHHC CPHTLFGAAFIAVSFDHPILQYVNDSKVIQLINDFDRKNLISDVSSTIEKFGIDSGLVVK CCHHHHHHHHEEEECCCHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCEEE HPLLNVNLPVYIVNFVLMDYATGAIFGCPAHDQRDFEFAKKYSLPVKQVVFPEVDVNLDK CCCEECCCHHHHHHHHHHHHCCCCEEECCCCCCCCHHHHHHHCCCHHHHCCCCCCCCCCC EAYVGSGIMKHSDFLDGMTVDEAKKAIVAKLTFLGVCKEITYYRMHDWGISRQRYWGCPI HHHHCCCHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHEEEECCCCCCCCCCCCCC PIIYCKKCGTVPVDKKDLPVTLPKDVDFTKYGNPLDNHPTWKYVKCPSCGMDAERETDTF CEEEECCCCCCCCCCCCCCEECCCCCCHHHCCCCCCCCCCEEEEECCCCCCCCCCCCCHH DTFFESSWYFAAFCGTSNGINKDVCNMLLPVNYYVGGVEHAVLHLLYSRFFCRALTKCGY HHHHCCCCEEEEEECCCCCCCHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHCCC FNIKEPFSNLITQGMVCHSTYSDEQGNYLFPEEAKKMMENGQHVTVGRAEKMSKSKKNVV CCCHHHHHHHHHCCEEEECCCCCCCCCEECHHHHHHHHHCCCEEEECCHHHHHHHHCCEE NLEYIIDKYGADTARLFILSDTPPERDIEWLDDGIEGASRYLSKLWRVIISYDKFNLNFN EHHHHHHHCCCCEEEEEEEECCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHEEECCC KENIIGDDVKYRRSVHKILSGITNDLDFCRLNCAVAKFRELSNIISEMIRTSVNCYVVSE CCCCCCCHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEHHH AIYILIRVIEPFIPHIAEKLWENIGGKGMLWNQVWPKADSELLVERNVTIVVQVNGKFVK HHHHHHHHHHHHHHHHHHHHHHHCCCCCEEECCCCCCCCCCEEEECCCEEEEEECCCEEE ALTVANDIDDDQLKSMALEIAKNRIGGNVVKDIYVIPKRVINIVAVKPS EEEECCCCCHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHEEEEEECCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: NA