| Definition | Halobacterium sp. NRC-1 plasmid pNRC200, complete sequence. |
|---|---|
| Accession | NC_002608 |
| Length | 365,425 |
Click here to switch to the map view.
The map label for this gene is argS
Identifier: 16120221
GI number: 16120221
Start: 240914
End: 242809
Strand: Direct
Name: argS
Synonym: VNG6312G
Alternate gene names: 16120221
Gene position: 240914-242809 (Clockwise)
Preceding gene: 16120220
Following gene: 16120227
Centisome position: 65.93
GC content: 62.39
Gene sequence:
>1896_bases ATGCTTTATAACCTTCGGCAGGAACTGCTCGCTGGAATCCGGGCTGCCACCTCTGACGCGGGGTACGACTATGAAGTCGA CCAGTCCGCGATCGAACTCGAAGACATCACCGATGAGGAGAAAGGCGAGTTCTCCTCACCGATCTCGTTCTCGATCGCGG CCGCGGCCGGAGCGCCCCCGGTCGATGTCGCGGCGGCGATCGCCGACGCCCACCGCTCCAACGGGCTGCCGGCTGAAGTC GAGGCGGTGACCGTCGAAGGCGGCCACATCAACTACCACGCCGACACGACCGATCTGGCAGACGCGACGCTGTCGACGAT CCTCCGCGACGGTTCGGAGTACGGCACGCGGACGGACGCCGACCCGGACACCATCCTCGCCGACGTGTCCTCGCCCAACA TCGCCAAGCCGCTGCACGTCGGCCACTTGCGGAACACGATCCTCAGCGATGCAGTGATGAACATCCTGGAGGCGCGCGGC CACGACGTCACGCGGGACAACCATCTCGGGGATTGGGGCGTGCAGTTCGGGAACCTGATGCACGAGTACACCGAGTTCGG CGACGAAGCGACGCTGGAAGACGACGCCATCGAACACCTCCTGGATCTCTACCAGCAGTTCGAGCAGCGGGACTCGATGC TCGCGGATCTCGAAGACGATGAGACCGTGACCGACCAGTTCGCCGACGCCGTCACCGAGGAACGTGACTACCACGCCGAC AGCGGCAAGGAGTGGTTCACCCGGCTCGAGCAGGGCGACGAGGACGCGACTGCCCTCTGGGAGCGGTTCCGTACCGTGAG CATCGATCGCTTCAAGCAGACCTACGACGACCTCGATGTCGCATTCGACGTTTGGAACGGGGAGAGCTTCTACGCTCAGG AGGGCTGGAACGACGTCATCATCGAGAAGGCGATCGAGAACGACGTCGCGATGCGCGGCGAGGGCGAGTCGGTGTACATC CCGGTGTACCCTGACGACTACGAGAACGTCGGCGACCCGCAAGCGGCAGACGTGGACGCCTCGCTCGATCGCGCACGCCA GATGCGGGAGGCCAACGACGACCTCGAAGACGCCGACTTCGATCCGTTCTACATCGTCAAGTCCGATGGATCGACGCTGT ACGGAACCCGCGACCTGGCGACGATCGAGTACCGGATCGAGGAATACGACGCCGATCAGTCGGTCTACGTGGTGGCAAAC GAACAGAACCAGTACTTCCAACAGCTGTTCGTCGCTGCCCGAAAGATGGGATACAACGACATCAAACTTAAGCACATCGA TTACGGGCTGATCAGCCTCCCCGAAGGGAGCATGTCGACACGGAAAGGACAGATCATCACCGCCCGGGAAGTCCTTGATC GTGCCCAGGACCGCGCCGAGGAGATCATCGCGGAGAAAGGCCGAATCGACGACGCCGAAGCCCAATCGGTCGCAACCAAG ATCGCGCTCGCAACCATCAAATACGAGATGGTGGCGGCCAAACGCGAACGCGACACGACGTTCGACATCGACGAGTCGGT TGCACTGGAGGGCGACACCGGACCGTACGTTCAGTACGCGGCAACCCGTGGCTACAGCATTCTGGACGGAGCGGACGCCG CTCCCGAGATCGACGACCTCGATCCATCGGTGTTCAACGACACCGATGTGGAGCTGCTGTTCGAGCTGGCCCGCTACCCA CTCGTCCTGGAACGCTGTGAGGAACGGTACGACGCGGCACCGCTTGCCCACTACCTCCTCCAGCTCGCACACGTGTTCAA CTCCTTCTACCACAAGAACGCGGTCTTGGACGCCGAAAACGCACGCACGGAGCGCCTCCTGCTGACGAAGGCAACGACAC AGATCTTCGACAACGGCCTCGGCCTGCTCGGCATCGACGTGCTCGAAGAGATGTAA
Upstream 100 bases:
>100_bases CTCTCGTTATTGTGTTGATTACTGTTCGACTGCTGCCGGGCGAACCACTGGCCCGGATGTAGCAGAATTTATCGTTCTGG AGGGTGAAGGCTCGCATATA
Downstream 100 bases:
>100_bases CCGCGCTGGACATCGTTGAATCGGTTTTGAGGTCCGTGAAACTCGGTTGGCAGCTACTACGATCGCTGTAAGAACGACAC AGGAGCGCCGGTGTCTTCCG
Product: arginine-tRNA synthetase
Products: NA
Alternate protein names: Arginine--tRNA ligase; ArgRS
Number of amino acids: Translated: 631; Mature: 631
Protein sequence:
>631_residues MLYNLRQELLAGIRAATSDAGYDYEVDQSAIELEDITDEEKGEFSSPISFSIAAAAGAPPVDVAAAIADAHRSNGLPAEV EAVTVEGGHINYHADTTDLADATLSTILRDGSEYGTRTDADPDTILADVSSPNIAKPLHVGHLRNTILSDAVMNILEARG HDVTRDNHLGDWGVQFGNLMHEYTEFGDEATLEDDAIEHLLDLYQQFEQRDSMLADLEDDETVTDQFADAVTEERDYHAD SGKEWFTRLEQGDEDATALWERFRTVSIDRFKQTYDDLDVAFDVWNGESFYAQEGWNDVIIEKAIENDVAMRGEGESVYI PVYPDDYENVGDPQAADVDASLDRARQMREANDDLEDADFDPFYIVKSDGSTLYGTRDLATIEYRIEEYDADQSVYVVAN EQNQYFQQLFVAARKMGYNDIKLKHIDYGLISLPEGSMSTRKGQIITAREVLDRAQDRAEEIIAEKGRIDDAEAQSVATK IALATIKYEMVAAKRERDTTFDIDESVALEGDTGPYVQYAATRGYSILDGADAAPEIDDLDPSVFNDTDVELLFELARYP LVLERCEERYDAAPLAHYLLQLAHVFNSFYHKNAVLDAENARTERLLLTKATTQIFDNGLGLLGIDVLEEM
Sequences:
>Translated_631_residues MLYNLRQELLAGIRAATSDAGYDYEVDQSAIELEDITDEEKGEFSSPISFSIAAAAGAPPVDVAAAIADAHRSNGLPAEV EAVTVEGGHINYHADTTDLADATLSTILRDGSEYGTRTDADPDTILADVSSPNIAKPLHVGHLRNTILSDAVMNILEARG HDVTRDNHLGDWGVQFGNLMHEYTEFGDEATLEDDAIEHLLDLYQQFEQRDSMLADLEDDETVTDQFADAVTEERDYHAD SGKEWFTRLEQGDEDATALWERFRTVSIDRFKQTYDDLDVAFDVWNGESFYAQEGWNDVIIEKAIENDVAMRGEGESVYI PVYPDDYENVGDPQAADVDASLDRARQMREANDDLEDADFDPFYIVKSDGSTLYGTRDLATIEYRIEEYDADQSVYVVAN EQNQYFQQLFVAARKMGYNDIKLKHIDYGLISLPEGSMSTRKGQIITAREVLDRAQDRAEEIIAEKGRIDDAEAQSVATK IALATIKYEMVAAKRERDTTFDIDESVALEGDTGPYVQYAATRGYSILDGADAAPEIDDLDPSVFNDTDVELLFELARYP LVLERCEERYDAAPLAHYLLQLAHVFNSFYHKNAVLDAENARTERLLLTKATTQIFDNGLGLLGIDVLEEM >Mature_631_residues MLYNLRQELLAGIRAATSDAGYDYEVDQSAIELEDITDEEKGEFSSPISFSIAAAAGAPPVDVAAAIADAHRSNGLPAEV EAVTVEGGHINYHADTTDLADATLSTILRDGSEYGTRTDADPDTILADVSSPNIAKPLHVGHLRNTILSDAVMNILEARG HDVTRDNHLGDWGVQFGNLMHEYTEFGDEATLEDDAIEHLLDLYQQFEQRDSMLADLEDDETVTDQFADAVTEERDYHAD SGKEWFTRLEQGDEDATALWERFRTVSIDRFKQTYDDLDVAFDVWNGESFYAQEGWNDVIIEKAIENDVAMRGEGESVYI PVYPDDYENVGDPQAADVDASLDRARQMREANDDLEDADFDPFYIVKSDGSTLYGTRDLATIEYRIEEYDADQSVYVVAN EQNQYFQQLFVAARKMGYNDIKLKHIDYGLISLPEGSMSTRKGQIITAREVLDRAQDRAEEIIAEKGRIDDAEAQSVATK IALATIKYEMVAAKRERDTTFDIDESVALEGDTGPYVQYAATRGYSILDGADAAPEIDDLDPSVFNDTDVELLFELARYP LVLERCEERYDAAPLAHYLLQLAHVFNSFYHKNAVLDAENARTERLLLTKATTQIFDNGLGLLGIDVLEEM
Specific function: Unknown
COG id: COG0018
COG function: function code J; Arginyl-tRNA synthetase
Gene ontology:
Cell location: Cytoplasm
Metaboloic importance: Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the class-I aminoacyl-tRNA synthetase family
Homologues:
Organism=Homo sapiens, GI197100773, Length=587, Percent_Identity=29.1311754684838, Blast_Score=232, Evalue=6e-61, Organism=Homo sapiens, GI15149476, Length=573, Percent_Identity=28.0977312390925, Blast_Score=180, Evalue=3e-45, Organism=Escherichia coli, GI1788184, Length=639, Percent_Identity=30.0469483568075, Blast_Score=222, Evalue=7e-59, Organism=Caenorhabditis elegans, GI71985061, Length=631, Percent_Identity=28.2091917591125, Blast_Score=184, Evalue=1e-46, Organism=Caenorhabditis elegans, GI71985068, Length=592, Percent_Identity=28.8851351351351, Blast_Score=177, Evalue=1e-44, Organism=Caenorhabditis elegans, GI17532153, Length=546, Percent_Identity=26.007326007326, Blast_Score=140, Evalue=3e-33, Organism=Saccharomyces cerevisiae, GI6321883, Length=636, Percent_Identity=30.8176100628931, Blast_Score=271, Evalue=2e-73, Organism=Saccharomyces cerevisiae, GI6320548, Length=620, Percent_Identity=30, Blast_Score=255, Evalue=2e-68, Organism=Drosophila melanogaster, GI18859963, Length=577, Percent_Identity=27.0363951473137, Blast_Score=179, Evalue=6e-45, Organism=Drosophila melanogaster, GI28571570, Length=526, Percent_Identity=26.9961977186312, Blast_Score=169, Evalue=4e-42,
Paralogues:
None
Copy number: 789 Molecules/Cell In: Growth Phase, Glucose-minimal MOPS Media. 800 Molecules/Cell In: Glucose minimal media [C]
Swissprot (AC and ID): SYR_HALSA (Q9HHN2)
Other databases:
- EMBL: AE004438 - RefSeq: NP_395809.1 - ProteinModelPortal: Q9HHN2 - SMR: Q9HHN2 - GeneID: 1449192 - GenomeReviews: AE004438_GR - KEGG: hal:VNG6312G - NMPDR: fig|64091.1.peg.2493 - HOGENOM: HBG695395 - OMA: AYKKWGN - ProtClustDB: CLSK2301553 - BioCyc: HSP64091:VNG6312G-MONOMER - BRENDA: 6.1.1.19 - GO: GO:0005737 - HAMAP: MF_00123 - InterPro: IPR001412 - InterPro: IPR001278 - InterPro: IPR015945 - InterPro: IPR005148 - InterPro: IPR008909 - InterPro: IPR014729 - InterPro: IPR009080 - Gene3D: G3DSA:3.30.1360.70 - Gene3D: G3DSA:3.40.50.620 - PANTHER: PTHR11956 - PRINTS: PR01038 - SMART: SM00836 - TIGRFAMs: TIGR00456
Pfam domain/function: PF03485 Arg_tRNA_synt_N; PF05746 DALR_1; PF00750 tRNA-synt_1d; SSF55190 Arg-tRNA-synth_Ic_N; SSF47323 tRNAsyn_1a_bind
EC number: =6.1.1.19
Molecular weight: Translated: 70472; Mature: 70472
Theoretical pI: Translated: 3.95; Mature: 3.95
Prosite motif: PS00178 AA_TRNA_LIGASE_I
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.2 %Cys (Translated Protein) 1.6 %Met (Translated Protein) 1.7 %Cys+Met (Translated Protein) 0.2 %Cys (Mature Protein) 1.6 %Met (Mature Protein) 1.7 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MLYNLRQELLAGIRAATSDAGYDYEVDQSAIELEDITDEEKGEFSSPISFSIAAAAGAPP CCCCHHHHHHHHHHHHCCCCCCCEECCCCCEEHHHCCCCCCCCCCCCCEEEEEECCCCCC VDVAAAIADAHRSNGLPAEVEAVTVEGGHINYHADTTDLADATLSTILRDGSEYGTRTDA HHHHHHHHHHHHCCCCCCEEEEEEEECCEEEEECCCHHHHHHHHHHHHHCCHHCCCCCCC DPDTILADVSSPNIAKPLHVGHLRNTILSDAVMNILEARGHDVTRDNHLGDWGVQFGNLM CCCCEEEECCCCCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCHHHHHHHHHH HEYTEFGDEATLEDDAIEHLLDLYQQFEQRDSMLADLEDDETVTDQFADAVTEERDYHAD HHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHCCCCCC SGKEWFTRLEQGDEDATALWERFRTVSIDRFKQTYDDLDVAFDVWNGESFYAQEGWNDVI CCHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHCCCEEEEEECCCEEECCCCCCHHH IEKAIENDVAMRGEGESVYIPVYPDDYENVGDPQAADVDASLDRARQMREANDDLEDADF HHHHHHCCCEECCCCCEEEEEECCCCCCCCCCCCCCCCCHHHHHHHHHHHCCCCCCCCCC DPFYIVKSDGSTLYGTRDLATIEYRIEEYDADQSVYVVANEQNQYFQQLFVAARKMGYND CCEEEEECCCCEEECCCCEEEEEEEEHHCCCCCEEEEEECCHHHHHHHHHHHHHHCCCCC IKLKHIDYGLISLPEGSMSTRKGQIITAREVLDRAQDRAEEIIAEKGRIDDAEAQSVATK EEEEEECCCEEECCCCCCCCCCCCEEEHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHH IALATIKYEMVAAKRERDTTFDIDESVALEGDTGPYVQYAATRGYSILDGADAAPEIDDL HHHHHHHHHHHHHHHCCCCCCCCCCCEEEECCCCCCEEEHHCCCCEEECCCCCCCCCCCC DPSVFNDTDVELLFELARYPLVLERCEERYDAAPLAHYLLQLAHVFNSFYHKNAVLDAEN CCCCCCCCHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHCCEEECCC ARTERLLLTKATTQIFDNGLGLLGIDVLEEM CCCCEEEEHHHHHHHHHCCCCEEHHHHHHCC >Mature Secondary Structure MLYNLRQELLAGIRAATSDAGYDYEVDQSAIELEDITDEEKGEFSSPISFSIAAAAGAPP CCCCHHHHHHHHHHHHCCCCCCCEECCCCCEEHHHCCCCCCCCCCCCCEEEEEECCCCCC VDVAAAIADAHRSNGLPAEVEAVTVEGGHINYHADTTDLADATLSTILRDGSEYGTRTDA HHHHHHHHHHHHCCCCCCEEEEEEEECCEEEEECCCHHHHHHHHHHHHHCCHHCCCCCCC DPDTILADVSSPNIAKPLHVGHLRNTILSDAVMNILEARGHDVTRDNHLGDWGVQFGNLM CCCCEEEECCCCCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCHHHHHHHHHH HEYTEFGDEATLEDDAIEHLLDLYQQFEQRDSMLADLEDDETVTDQFADAVTEERDYHAD HHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHCCCCCC SGKEWFTRLEQGDEDATALWERFRTVSIDRFKQTYDDLDVAFDVWNGESFYAQEGWNDVI CCHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHCCCEEEEEECCCEEECCCCCCHHH IEKAIENDVAMRGEGESVYIPVYPDDYENVGDPQAADVDASLDRARQMREANDDLEDADF HHHHHHCCCEECCCCCEEEEEECCCCCCCCCCCCCCCCCHHHHHHHHHHHCCCCCCCCCC DPFYIVKSDGSTLYGTRDLATIEYRIEEYDADQSVYVVANEQNQYFQQLFVAARKMGYND CCEEEEECCCCEEECCCCEEEEEEEEHHCCCCCEEEEEECCHHHHHHHHHHHHHHCCCCC IKLKHIDYGLISLPEGSMSTRKGQIITAREVLDRAQDRAEEIIAEKGRIDDAEAQSVATK EEEEEECCCEEECCCCCCCCCCCCEEEHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHH IALATIKYEMVAAKRERDTTFDIDESVALEGDTGPYVQYAATRGYSILDGADAAPEIDDL HHHHHHHHHHHHHHHCCCCCCCCCCCEEEECCCCCCEEEHHCCCCEEECCCCCCCCCCCC DPSVFNDTDVELLFELARYPLVLERCEERYDAAPLAHYLLQLAHVFNSFYHKNAVLDAEN CCCCCCCCHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHCCEEECCC ARTERLLLTKATTQIFDNGLGLLGIDVLEEM CCCCEEEEHHHHHHHHHCCCCEEHHHHHHCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 11016950