| Definition | Rhodopseudomonas palustris HaA2, complete genome. |
|---|---|
| Accession | NC_007778 |
| Length | 5,331,656 |
Click here to switch to the map view.
The map label for this gene is leuS [H]
Identifier: 86747511
GI number: 86747511
Start: 426566
End: 429190
Strand: Direct
Name: leuS [H]
Synonym: RPB_0385
Alternate gene names: 86747511
Gene position: 426566-429190 (Clockwise)
Preceding gene: 86747510
Following gene: 86747512
Centisome position: 8.0
GC content: 65.87
Gene sequence:
>2625_bases ATGAGCAACGAACGTTACAACGCCCGCGAATCCGAGCCGAAATGGCAGGCGAAATGGGACGAGGCGAAAATTTTCGCCAC CCGGAACGACGACCCGCGCCCAAAGTATTACGTGCTGGAGATGTTCCCGTATCCGTCGGGCCGCATCCATATGGGGCACG TCCGCAACTACACCATGGGCGACGTGGTGGCGCGGACGATGCGGGCGCGCGGCCACAACGTGCTGCACCCGATGGGCTGG GACGCGTTCGGCCTGCCGGCCGAGAACGCCGCGATTGAGCGCAAGGTCGCGCCCAAGGCCTGGACCTACGACAACATCGC TTCAATGAAGAAGCAGCTCCAGACCATGGGGCTGTCGCTCGACTGGGCGCGTGAATTCGCGACCTGCGATCCGACCTACT ACAAGCATCAGCAGAAGATGTTCCTGGATTTCCTGAAGGTCGGCCTGGCCGAACGGGAAACCCGCAAGCTCAACTGGGAC CCGGTCGACATGACCGTGCTGGCCAACGAGCAGGTGATCGACGGCCGCGGCTGGCGCTCCGGCGCGGTGGTCGAGCAGCG CGAGATGAACCAGTGGGTGTTCAAGATCACCCGCTACGCGCAGGACCTGCTCGACGCGCTGGAAACGCTCGACCGCTGGC CCGACAAGGTCCGGCTGATGCAGCGCAACTGGATCGGCCGCAGCGAAGGCCTGTTGGTGCGGTTCGCGCTGGATGCGGCG ACGACGCCGGCCGGCGAGACCGAGCTGAAGATTTTCACCACGCGGCCCGACACGCTGTTCGGCGCCAAATTCATGGCGAT CGCGCCGGATCATCCGCTGGCGCAGGCGGCGGCCGCCAAGAACGAGAAGATCGCGGCCTTCGTCGAGGAGTGCAAGAAGC GCGGCACCGCGCAGGCCGAGATCGACACCGCCGAGAAGCAGGGCATCGACACCGGCATCCGCGCGCTGCATCCGTTCGAC CCGACCTGGCAGATCCCGGTCTATGTGGCGAATTTCGTGCTGATGGAATACGGCACCGGCGCCATCTTCGGCTGCCCGGC GCACGACCAGCGCGACCTCGATTTCGTCAACAAGTACCAGCTTGGTAATACGCCCGTTGTGTGCCCCGAGGGCCAGGACC CTTTGAGCTTCGTCATCACCGACGAGGCCTATGACGGCGACGGCCGCCTGATCAATTCGCGCTTCCTCGACGGCATGAGC ATCGCGGACGCGAAGGAAGAAGTGGCGAAGCGGCTGGAGACAGCGACGCTCGGCAATGCGCCGGTCGGCGAGCGCAAGGT CAATTTCCGCCTGCGCGACTGGGGGATTTCACGCCAGCGCTATTGGGGCTGCCCGATCCCGGTGATCCATTGCGAGGTCT GCGGCGTCGTGCCGGTGCCGGACAAGGACCTGCCCGTCGTGCTGCCGGAGGACGTGTCGTTCGACAAGCCCGGCAACGCG CTCGACCATCACCCGACCTGGAAGCACGTGCCCTGCCCGCAATGCGGCGGCAAAGCGCAGCGCGAAACCGACACCATGGA CACCTTCGTGGATTCGTCCTGGTACTTCGCGCGCTTCACCGATCCGTGGAACGAGACCGCGCCGACCACGCCCGACGTGG TCAACCGGATGCTGCCGGTCGATCAATATATCGGCGGCGTCGAGCACGCGATCCTGCATCTCTTGTACAGCCGGTTCTTC ACCCGGGCGATGAAGGCCACCGGCCATCTCGGCCTGGACGAGCCGTTCCGCGGCATGTTCACCCAGGGCATGGTGGTGCA CGAGACCTACCGCACCGCCGACGGCCATTTCGCCTCGCCGGCCGAAGTCGCGATCGTGGCCGAGGGCGACGGCCGCCGCG CCACGCTGCTCGACGGCGGCACGCCGGTCGAGATCGGCCCGATCGAAAAGATGTCGAAGAGTAAGCGCAACACCGTCGAT CCCGACGACATCATCGGCTCTTACGGCGCCGACACCGCGCGCTGGTTCATGCTGTCGGATTCGCCGCCGGACCGCGACGT GATCTGGAGCGAGGAAGGCGTCAAGGGCGCATCGCGCTTCGTGCAGCGGCTGTGGCGGATGGTGAATGACGCCGCCGCCA TCGCCCGTTCGGCCCCGGCCGAGCGGCCGGCGACGTTCGGCCCCGAGGCGCTGGCGGTGCGCAAGGCCGCGCATGGCGCG CTCGACAAGGTGTTGAGCGGCATCGAACGGCTCGCCTTCAATGTCAGCCTCGCCCATATCCGCGAATTCGCCAACAGCTT CGGCGAGGCGCTGGCGAAGCCGGGCCAGCCGTCGCCGGATCTGGCCTGGGCGATCCGCGAGGCCGCGGTCATCCTTGTTC AACTGTTTCACCCGATGATGCCGCATCTGGCCGAGGAATGCTGGGCGGCGCTGGGCCGGCCGGGCCTGGTCTCCGAGGCG CTGTGGCCGCAAATCGAACGCGATTTGCTGGTCGAAGACAGCATCACCCTGCCGGTACAGGTCAACGGCAAGAAACGCGG GGACATCACGGTGGCCAGGGACGCCAACACCCAGGAAATTGAGGCTGCCGTTTTGGCCCTCGATGCGGTAAGACAGGCGC TGGACGGCAAGCCCGTCCGCAAGGTGATCGTGGTGCCGCAGAGGATCGTGAATGTCGTCGGTTAG
Upstream 100 bases:
>100_bases CCGCCTGAGCCGCACCGGTTTGCGACCTCATTCGCGCTTCCTTGAATGTGCACAGCGCTCGAACCGGCCGGCCGACTGAT CTCCAGCCTGACTGATCTCC
Downstream 100 bases:
>100_bases GCCCGCATTGGCGAAGATGGTCGCGAGGCTGGCGCTCGCCGCAATGCTGGCGGCGCCGCTGGCTGGATGCTTCCAGCCGA TGTATGCCGACCGCGGCGAC
Product: leucyl-tRNA synthetase
Products: NA
Alternate protein names: Leucine--tRNA ligase; LeuRS [H]
Number of amino acids: Translated: 874; Mature: 873
Protein sequence:
>874_residues MSNERYNARESEPKWQAKWDEAKIFATRNDDPRPKYYVLEMFPYPSGRIHMGHVRNYTMGDVVARTMRARGHNVLHPMGW DAFGLPAENAAIERKVAPKAWTYDNIASMKKQLQTMGLSLDWAREFATCDPTYYKHQQKMFLDFLKVGLAERETRKLNWD PVDMTVLANEQVIDGRGWRSGAVVEQREMNQWVFKITRYAQDLLDALETLDRWPDKVRLMQRNWIGRSEGLLVRFALDAA TTPAGETELKIFTTRPDTLFGAKFMAIAPDHPLAQAAAAKNEKIAAFVEECKKRGTAQAEIDTAEKQGIDTGIRALHPFD PTWQIPVYVANFVLMEYGTGAIFGCPAHDQRDLDFVNKYQLGNTPVVCPEGQDPLSFVITDEAYDGDGRLINSRFLDGMS IADAKEEVAKRLETATLGNAPVGERKVNFRLRDWGISRQRYWGCPIPVIHCEVCGVVPVPDKDLPVVLPEDVSFDKPGNA LDHHPTWKHVPCPQCGGKAQRETDTMDTFVDSSWYFARFTDPWNETAPTTPDVVNRMLPVDQYIGGVEHAILHLLYSRFF TRAMKATGHLGLDEPFRGMFTQGMVVHETYRTADGHFASPAEVAIVAEGDGRRATLLDGGTPVEIGPIEKMSKSKRNTVD PDDIIGSYGADTARWFMLSDSPPDRDVIWSEEGVKGASRFVQRLWRMVNDAAAIARSAPAERPATFGPEALAVRKAAHGA LDKVLSGIERLAFNVSLAHIREFANSFGEALAKPGQPSPDLAWAIREAAVILVQLFHPMMPHLAEECWAALGRPGLVSEA LWPQIERDLLVEDSITLPVQVNGKKRGDITVARDANTQEIEAAVLALDAVRQALDGKPVRKVIVVPQRIVNVVG
Sequences:
>Translated_874_residues MSNERYNARESEPKWQAKWDEAKIFATRNDDPRPKYYVLEMFPYPSGRIHMGHVRNYTMGDVVARTMRARGHNVLHPMGW DAFGLPAENAAIERKVAPKAWTYDNIASMKKQLQTMGLSLDWAREFATCDPTYYKHQQKMFLDFLKVGLAERETRKLNWD PVDMTVLANEQVIDGRGWRSGAVVEQREMNQWVFKITRYAQDLLDALETLDRWPDKVRLMQRNWIGRSEGLLVRFALDAA TTPAGETELKIFTTRPDTLFGAKFMAIAPDHPLAQAAAAKNEKIAAFVEECKKRGTAQAEIDTAEKQGIDTGIRALHPFD PTWQIPVYVANFVLMEYGTGAIFGCPAHDQRDLDFVNKYQLGNTPVVCPEGQDPLSFVITDEAYDGDGRLINSRFLDGMS IADAKEEVAKRLETATLGNAPVGERKVNFRLRDWGISRQRYWGCPIPVIHCEVCGVVPVPDKDLPVVLPEDVSFDKPGNA LDHHPTWKHVPCPQCGGKAQRETDTMDTFVDSSWYFARFTDPWNETAPTTPDVVNRMLPVDQYIGGVEHAILHLLYSRFF TRAMKATGHLGLDEPFRGMFTQGMVVHETYRTADGHFASPAEVAIVAEGDGRRATLLDGGTPVEIGPIEKMSKSKRNTVD PDDIIGSYGADTARWFMLSDSPPDRDVIWSEEGVKGASRFVQRLWRMVNDAAAIARSAPAERPATFGPEALAVRKAAHGA LDKVLSGIERLAFNVSLAHIREFANSFGEALAKPGQPSPDLAWAIREAAVILVQLFHPMMPHLAEECWAALGRPGLVSEA LWPQIERDLLVEDSITLPVQVNGKKRGDITVARDANTQEIEAAVLALDAVRQALDGKPVRKVIVVPQRIVNVVG >Mature_873_residues SNERYNARESEPKWQAKWDEAKIFATRNDDPRPKYYVLEMFPYPSGRIHMGHVRNYTMGDVVARTMRARGHNVLHPMGWD AFGLPAENAAIERKVAPKAWTYDNIASMKKQLQTMGLSLDWAREFATCDPTYYKHQQKMFLDFLKVGLAERETRKLNWDP VDMTVLANEQVIDGRGWRSGAVVEQREMNQWVFKITRYAQDLLDALETLDRWPDKVRLMQRNWIGRSEGLLVRFALDAAT TPAGETELKIFTTRPDTLFGAKFMAIAPDHPLAQAAAAKNEKIAAFVEECKKRGTAQAEIDTAEKQGIDTGIRALHPFDP TWQIPVYVANFVLMEYGTGAIFGCPAHDQRDLDFVNKYQLGNTPVVCPEGQDPLSFVITDEAYDGDGRLINSRFLDGMSI ADAKEEVAKRLETATLGNAPVGERKVNFRLRDWGISRQRYWGCPIPVIHCEVCGVVPVPDKDLPVVLPEDVSFDKPGNAL DHHPTWKHVPCPQCGGKAQRETDTMDTFVDSSWYFARFTDPWNETAPTTPDVVNRMLPVDQYIGGVEHAILHLLYSRFFT RAMKATGHLGLDEPFRGMFTQGMVVHETYRTADGHFASPAEVAIVAEGDGRRATLLDGGTPVEIGPIEKMSKSKRNTVDP DDIIGSYGADTARWFMLSDSPPDRDVIWSEEGVKGASRFVQRLWRMVNDAAAIARSAPAERPATFGPEALAVRKAAHGAL DKVLSGIERLAFNVSLAHIREFANSFGEALAKPGQPSPDLAWAIREAAVILVQLFHPMMPHLAEECWAALGRPGLVSEAL WPQIERDLLVEDSITLPVQVNGKKRGDITVARDANTQEIEAAVLALDAVRQALDGKPVRKVIVVPQRIVNVVG
Specific function: Unknown
COG id: COG0495
COG function: function code J; Leucyl-tRNA synthetase
Gene ontology:
Cell location: Cytoplasm [H]
Metaboloic importance: Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the class-I aminoacyl-tRNA synthetase family [H]
Homologues:
Organism=Homo sapiens, GI7661872, Length=894, Percent_Identity=34.1163310961969, Blast_Score=511, Evalue=1e-144, Organism=Escherichia coli, GI1786861, Length=877, Percent_Identity=44.6978335233751, Blast_Score=743, Evalue=0.0, Organism=Escherichia coli, GI1790708, Length=402, Percent_Identity=22.636815920398, Blast_Score=84, Evalue=5e-17, Organism=Caenorhabditis elegans, GI71997517, Length=247, Percent_Identity=40.080971659919, Blast_Score=213, Evalue=3e-55, Organism=Caenorhabditis elegans, GI71997510, Length=247, Percent_Identity=40.080971659919, Blast_Score=213, Evalue=3e-55, Organism=Caenorhabditis elegans, GI212645227, Length=316, Percent_Identity=30.6962025316456, Blast_Score=138, Evalue=1e-32, Organism=Caenorhabditis elegans, GI71980946, Length=483, Percent_Identity=22.360248447205, Blast_Score=71, Evalue=3e-12, Organism=Saccharomyces cerevisiae, GI6323414, Length=857, Percent_Identity=36.8728121353559, Blast_Score=552, Evalue=1e-157, Organism=Saccharomyces cerevisiae, GI6321531, Length=390, Percent_Identity=23.3333333333333, Blast_Score=83, Evalue=2e-16, Organism=Saccharomyces cerevisiae, GI6325217, Length=141, Percent_Identity=26.241134751773, Blast_Score=64, Evalue=1e-10, Organism=Drosophila melanogaster, GI21355409, Length=827, Percent_Identity=36.1547762998791, Blast_Score=451, Evalue=1e-126, Organism=Drosophila melanogaster, GI281366294, Length=706, Percent_Identity=22.0963172804533, Blast_Score=93, Evalue=9e-19,
Paralogues:
None
Copy number: 800 Molecules/Cell In: Glucose minimal media [C]
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR001412 - InterPro: IPR002300 - InterPro: IPR002302 - InterPro: IPR014729 - InterPro: IPR009080 - InterPro: IPR013155 - InterPro: IPR009008 [H]
Pfam domain/function: PF08264 Anticodon_1; PF00133 tRNA-synt_1 [H]
EC number: =6.1.1.4 [H]
Molecular weight: Translated: 97629; Mature: 97498
Theoretical pI: Translated: 6.17; Mature: 6.17
Prosite motif: PS00178 AA_TRNA_LIGASE_I
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.1 %Cys (Translated Protein) 2.9 %Met (Translated Protein) 4.0 %Cys+Met (Translated Protein) 1.1 %Cys (Mature Protein) 2.7 %Met (Mature Protein) 3.9 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MSNERYNARESEPKWQAKWDEAKIFATRNDDPRPKYYVLEMFPYPSGRIHMGHVRNYTMG CCCCCCCCCCCCCCCCCCCCCEEEEEECCCCCCCCEEEEEEECCCCCCEEECCCCCCCHH DVVARTMRARGHNVLHPMGWDAFGLPAENAAIERKVAPKAWTYDNIASMKKQLQTMGLSL HHHHHHHHHCCCCCCCCCCCCCCCCCCCCCHHHHCCCCCCCCHHHHHHHHHHHHHHCCCH DWAREFATCDPTYYKHQQKMFLDFLKVGLAERETRKLNWDPVDMTVLANEQVIDGRGWRS HHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCEEEEEECCEEECCCCCCC GAVVEQREMNQWVFKITRYAQDLLDALETLDRWPDKVRLMQRNWIGRSEGLLVRFALDAA CCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHCCCCCCCEEEEEEECCC TTPAGETELKIFTTRPDTLFGAKFMAIAPDHPLAQAAAAKNEKIAAFVEECKKRGTAQAE CCCCCCCEEEEEECCCCCHHCCEEEEECCCCCHHHHHHHCCCHHHHHHHHHHHCCCCCEE IDTAEKQGIDTGIRALHPFDPTWQIPVYVANFVLMEYGTGAIFGCPAHDQRDLDFVNKYQ ECHHHHCCCHHHHHHCCCCCCCCCHHHHHHHHHHHCCCCCCEEECCCCCCCCCHHHHHEE LGNTPVVCPEGQDPLSFVITDEAYDGDGRLINSRFLDGMSIADAKEEVAKRLETATLGNA CCCCCEECCCCCCCEEEEEECCCCCCCCCEEHHHHCCCCCHHHHHHHHHHHHHHHHCCCC PVGERKVNFRLRDWGISRQRYWGCPIPVIHCEVCGVVPVPDKDLPVVLPEDVSFDKPGNA CCCCCEEEEEEECCCCCCCCCCCCCCCEEEEEECCCCCCCCCCCCEECCCCCCCCCCCCC LDHHPTWKHVPCPQCGGKAQRETDTMDTFVDSSWYFARFTDPWNETAPTTPDVVNRMLPV CCCCCCCCCCCCCCCCCCCCCCHHHHHHHHCCCEEEEEECCCCCCCCCCCHHHHHHHCCH DQYIGGVEHAILHLLYSRFFTRAMKATGHLGLDEPFRGMFTQGMVVHETYRTADGHFASP HHHHCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCHHHHHHCCEEEEEEHCCCCCCCCCC AEVAIVAEGDGRRATLLDGGTPVEIGPIEKMSKSKRNTVDPDDIIGSYGADTARWFMLSD CCEEEEECCCCCEEEEECCCCCEEECCHHHHHHHCCCCCCHHHHHCCCCCCCEEEEEECC SPPDRDVIWSEEGVKGASRFVQRLWRMVNDAAAIARSAPAERPATFGPEALAVRKAAHGA CCCCCCEEECCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCHHHHHHHHHHHH LDKVLSGIERLAFNVSLAHIREFANSFGEALAKPGQPSPDLAWAIREAAVILVQLFHPMM HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHHHH PHLAEECWAALGRPGLVSEALWPQIERDLLVEDSITLPVQVNGKKRGDITVARDANTQEI HHHHHHHHHHHCCCCCHHHHHHHHHHHCEEEECCEEEEEEECCCCCCCEEEEECCCHHHH EAAVLALDAVRQALDGKPVRKVIVVPQRIVNVVG HHHHHHHHHHHHHHCCCCCCEEEECCHHHHHHCC >Mature Secondary Structure SNERYNARESEPKWQAKWDEAKIFATRNDDPRPKYYVLEMFPYPSGRIHMGHVRNYTMG CCCCCCCCCCCCCCCCCCCCEEEEEECCCCCCCCEEEEEEECCCCCCEEECCCCCCCHH DVVARTMRARGHNVLHPMGWDAFGLPAENAAIERKVAPKAWTYDNIASMKKQLQTMGLSL HHHHHHHHHCCCCCCCCCCCCCCCCCCCCCHHHHCCCCCCCCHHHHHHHHHHHHHHCCCH DWAREFATCDPTYYKHQQKMFLDFLKVGLAERETRKLNWDPVDMTVLANEQVIDGRGWRS HHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCEEEEEECCEEECCCCCCC GAVVEQREMNQWVFKITRYAQDLLDALETLDRWPDKVRLMQRNWIGRSEGLLVRFALDAA CCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHCCCCCCCEEEEEEECCC TTPAGETELKIFTTRPDTLFGAKFMAIAPDHPLAQAAAAKNEKIAAFVEECKKRGTAQAE CCCCCCCEEEEEECCCCCHHCCEEEEECCCCCHHHHHHHCCCHHHHHHHHHHHCCCCCEE IDTAEKQGIDTGIRALHPFDPTWQIPVYVANFVLMEYGTGAIFGCPAHDQRDLDFVNKYQ ECHHHHCCCHHHHHHCCCCCCCCCHHHHHHHHHHHCCCCCCEEECCCCCCCCCHHHHHEE LGNTPVVCPEGQDPLSFVITDEAYDGDGRLINSRFLDGMSIADAKEEVAKRLETATLGNA CCCCCEECCCCCCCEEEEEECCCCCCCCCEEHHHHCCCCCHHHHHHHHHHHHHHHHCCCC PVGERKVNFRLRDWGISRQRYWGCPIPVIHCEVCGVVPVPDKDLPVVLPEDVSFDKPGNA CCCCCEEEEEEECCCCCCCCCCCCCCCEEEEEECCCCCCCCCCCCEECCCCCCCCCCCCC LDHHPTWKHVPCPQCGGKAQRETDTMDTFVDSSWYFARFTDPWNETAPTTPDVVNRMLPV CCCCCCCCCCCCCCCCCCCCCCHHHHHHHHCCCEEEEEECCCCCCCCCCCHHHHHHHCCH DQYIGGVEHAILHLLYSRFFTRAMKATGHLGLDEPFRGMFTQGMVVHETYRTADGHFASP HHHHCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCHHHHHHCCEEEEEEHCCCCCCCCCC AEVAIVAEGDGRRATLLDGGTPVEIGPIEKMSKSKRNTVDPDDIIGSYGADTARWFMLSD CCEEEEECCCCCEEEEECCCCCEEECCHHHHHHHCCCCCCHHHHHCCCCCCCEEEEEECC SPPDRDVIWSEEGVKGASRFVQRLWRMVNDAAAIARSAPAERPATFGPEALAVRKAAHGA CCCCCCEEECCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCHHHHHHHHHHHH LDKVLSGIERLAFNVSLAHIREFANSFGEALAKPGQPSPDLAWAIREAAVILVQLFHPMM HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHHHH PHLAEECWAALGRPGLVSEALWPQIERDLLVEDSITLPVQVNGKKRGDITVARDANTQEI HHHHHHHHHHHCCCCCHHHHHHHHHHHCEEEECCEEEEEEECCCCCCCEEEEECCCHHHH EAAVLALDAVRQALDGKPVRKVIVVPQRIVNVVG HHHHHHHHHHHHHHCCCCCCEEEECCHHHHHHCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: NA