Definition Pyrococcus furiosus DSM 3638, complete genome.
Accession NC_003413
Length 1,908,256

Click here to switch to the map view.

The map label for this gene is argS

Identifier: 18977752

GI number: 18977752

Start: 1294497

End: 1296386

Strand: Direct

Name: argS

Synonym: PF1380

Alternate gene names: 18977752

Gene position: 1294497-1296386 (Clockwise)

Preceding gene: 18977751

Following gene: 18977755

Centisome position: 67.84

GC content: 37.14

Gene sequence:

>1890_bases
ATGATGGAAACAATAAAGTCCGAAATAAAGAGAACTATCGAAGGTATTGTAAGAGAAATGGCACCAGATTGGAGTGAGGA
TATACAATTTGTAGACACTCCAAGCCCAGAGTTGGGTGATTTTGGAACTCCAGTAGCATTTCAACTTGCCAGATTATTAA
GAAAATCTCCCCTCATTATTGCTCAGGAAATTGCAGAAAAATTTAACAAAAATAAACCAAAAGAGGTAAAAAAAGCTATA
GCAGTTAATGGATATGTAAACTTCTTCCTAGATTATCCACAGATCTCTAAATTAGTTATAGAAGCTATTTTAGGTTATGG
AACAGAATACGGCAGGTCAGAAATAGGAAAAGGGAAGAAAGTCATAGTGGAACATACTTCAGTTAATCCCACAAAGCCAC
TTCACATGGGGCATGCAAGAAATGCTATACTAGGAGATACAGTGGCAAGAATTCTGAGATTTTTGGGATATCAGGTTGAA
GTCCAAAACTATATTGATGATTTGGGAGTTCAATTTGCCCAAGTGTATTGGGGATATTTGAACTTAAAAAGGAAGTTTGA
TGAATTAATGAAAGAACTAAAAGAAAAAATACCAAAAAACAATCCAATAGATCATGTATTAGGGCTTCTCTATGTTGAGG
TTAATAAGAAAATTGAAGAGTCTTCTGAAGTAGAGAAGGAGATTAGAGAACTAATGAAAAAACTAGAAGAGAGAGAATTA
AACGGGAGGAAGCTTGCTGAAGAGGTCGTTAAGGCTCAGATGGAAACTTTGTATAGTCTGAACATTTATTATGATCTTTT
AGTTTGGGAAAGTGACATAGTTAGCACAAGGCTCTTTGAAAAAACAATCAAACTCCTCGAGAAAAATGAAAACTTTTACA
CTCCAAAAGAGGGGAAATACAAAGGAGCTTTTGTTATGGATTTAAGCAAGTTATTCCCCGATATGAAGAATCCTTATCTC
GTTCTTAGGAGAAGTGATGGAACAGCGACATACACAGGAAAAGACATAGCATACCACCTATGGAAATTTGGAAAAATAGA
CATTGACTTAATGTACAAGAAATGGGATGAGCATACGTGGACTACAGCCCCAGATGGAGAGCCAATACCAGGAAAGTTTG
GAGCGGGAGATATTGTCATTAATGTTATTGGGGCAGAGCAAAGACATCCTCAATTGGCAATTAAATATGCTTTAGAGTTG
CTCGGATACAAAGATGCCGCGGAAAACTTCCACCATTTAGCTTATGAGCACGTAGAAAGTCCAGAAGGAAAATTCTCAGG
TAGAAAAGGAACATGGGTTGGATTCACTGTAGATGAAGTTATAGCCGAAGCGATAAACAAAGCCAAGAGTTTAATAGAAG
AAAAGAATCCAAACTTAACAGAGGAAGAGAAAGAAGAAATAGCAAAGAAAGTGGCTGTTGGGGCTATAAGGTACACCCTC
ATCAAGTATAGTCCAGAGAAGAAAATTGTATTTAGATGGGAAGACGTGCTCAACTTTGAAGGAGAGAGTGCCCCTTACAT
TCAGTATGCCCATGCAAGATGTTCTTCAATCTTAAGAAAAGCTGAAGAATTAGGAATATCAACGGATTGGAAGTCACTTC
TAAAAGTGGCTAATTTTAACCAAATAACAGAAAAAGAAAGAGAATTAATAATGTTACTATCAAGGTTCCCAGAAATAGTT
CAGCAAGCTGGAACTGATCTTAAGCCCCACTTAATTGCATGGTATGCAAATGAGGTTGCCTCAACGTTCAACAAATTCTA
CATGGATCATCCAGTTATAAAAGCAGAAGAGGGAGTAAGAGAAGCAAGGCTCTTGCTTGTCATGGCTACAAGGCAAGTTC
TAAGGAATTCTCTTTGGTTAATGGGTATAGAGGCTCCAGATAAAATGTGA

Upstream 100 bases:

>100_bases
GTTGTTGTTGTAAGCTCAGAACATGAAGGAGGCGATAAACTTAAGGCCCTTGGAGGTATAGCTGCACTGTTGAGGTTTAA
AATCAAGTGAGGTGATAAAG

Downstream 100 bases:

>100_bases
TGCTCTATTTTTGTGTATTTTCCCTTATTACCTTTGCAATCTTATATTTTCTTCCATTACACTCAATGTCTCCAATTATC
TCCAGTATTTTCACAACGTC

Product: arginyl-tRNA synthetase

Products: NA

Alternate protein names: Arginine--tRNA ligase; ArgRS

Number of amino acids: Translated: 629; Mature: 629

Protein sequence:

>629_residues
MMETIKSEIKRTIEGIVREMAPDWSEDIQFVDTPSPELGDFGTPVAFQLARLLRKSPLIIAQEIAEKFNKNKPKEVKKAI
AVNGYVNFFLDYPQISKLVIEAILGYGTEYGRSEIGKGKKVIVEHTSVNPTKPLHMGHARNAILGDTVARILRFLGYQVE
VQNYIDDLGVQFAQVYWGYLNLKRKFDELMKELKEKIPKNNPIDHVLGLLYVEVNKKIEESSEVEKEIRELMKKLEEREL
NGRKLAEEVVKAQMETLYSLNIYYDLLVWESDIVSTRLFEKTIKLLEKNENFYTPKEGKYKGAFVMDLSKLFPDMKNPYL
VLRRSDGTATYTGKDIAYHLWKFGKIDIDLMYKKWDEHTWTTAPDGEPIPGKFGAGDIVINVIGAEQRHPQLAIKYALEL
LGYKDAAENFHHLAYEHVESPEGKFSGRKGTWVGFTVDEVIAEAINKAKSLIEEKNPNLTEEEKEEIAKKVAVGAIRYTL
IKYSPEKKIVFRWEDVLNFEGESAPYIQYAHARCSSILRKAEELGISTDWKSLLKVANFNQITEKERELIMLLSRFPEIV
QQAGTDLKPHLIAWYANEVASTFNKFYMDHPVIKAEEGVREARLLLVMATRQVLRNSLWLMGIEAPDKM

Sequences:

>Translated_629_residues
MMETIKSEIKRTIEGIVREMAPDWSEDIQFVDTPSPELGDFGTPVAFQLARLLRKSPLIIAQEIAEKFNKNKPKEVKKAI
AVNGYVNFFLDYPQISKLVIEAILGYGTEYGRSEIGKGKKVIVEHTSVNPTKPLHMGHARNAILGDTVARILRFLGYQVE
VQNYIDDLGVQFAQVYWGYLNLKRKFDELMKELKEKIPKNNPIDHVLGLLYVEVNKKIEESSEVEKEIRELMKKLEEREL
NGRKLAEEVVKAQMETLYSLNIYYDLLVWESDIVSTRLFEKTIKLLEKNENFYTPKEGKYKGAFVMDLSKLFPDMKNPYL
VLRRSDGTATYTGKDIAYHLWKFGKIDIDLMYKKWDEHTWTTAPDGEPIPGKFGAGDIVINVIGAEQRHPQLAIKYALEL
LGYKDAAENFHHLAYEHVESPEGKFSGRKGTWVGFTVDEVIAEAINKAKSLIEEKNPNLTEEEKEEIAKKVAVGAIRYTL
IKYSPEKKIVFRWEDVLNFEGESAPYIQYAHARCSSILRKAEELGISTDWKSLLKVANFNQITEKERELIMLLSRFPEIV
QQAGTDLKPHLIAWYANEVASTFNKFYMDHPVIKAEEGVREARLLLVMATRQVLRNSLWLMGIEAPDKM
>Mature_629_residues
MMETIKSEIKRTIEGIVREMAPDWSEDIQFVDTPSPELGDFGTPVAFQLARLLRKSPLIIAQEIAEKFNKNKPKEVKKAI
AVNGYVNFFLDYPQISKLVIEAILGYGTEYGRSEIGKGKKVIVEHTSVNPTKPLHMGHARNAILGDTVARILRFLGYQVE
VQNYIDDLGVQFAQVYWGYLNLKRKFDELMKELKEKIPKNNPIDHVLGLLYVEVNKKIEESSEVEKEIRELMKKLEEREL
NGRKLAEEVVKAQMETLYSLNIYYDLLVWESDIVSTRLFEKTIKLLEKNENFYTPKEGKYKGAFVMDLSKLFPDMKNPYL
VLRRSDGTATYTGKDIAYHLWKFGKIDIDLMYKKWDEHTWTTAPDGEPIPGKFGAGDIVINVIGAEQRHPQLAIKYALEL
LGYKDAAENFHHLAYEHVESPEGKFSGRKGTWVGFTVDEVIAEAINKAKSLIEEKNPNLTEEEKEEIAKKVAVGAIRYTL
IKYSPEKKIVFRWEDVLNFEGESAPYIQYAHARCSSILRKAEELGISTDWKSLLKVANFNQITEKERELIMLLSRFPEIV
QQAGTDLKPHLIAWYANEVASTFNKFYMDHPVIKAEEGVREARLLLVMATRQVLRNSLWLMGIEAPDKM

Specific function: Unknown

COG id: COG0018

COG function: function code J; Arginyl-tRNA synthetase

Gene ontology:

Cell location: Cytoplasm

Metaboloic importance: Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the class-I aminoacyl-tRNA synthetase family

Homologues:

Organism=Homo sapiens, GI15149476, Length=659, Percent_Identity=25.0379362670713, Blast_Score=138, Evalue=2e-32,
Organism=Homo sapiens, GI197100773, Length=560, Percent_Identity=25, Blast_Score=132, Evalue=7e-31,
Organism=Escherichia coli, GI1788184, Length=616, Percent_Identity=25.487012987013, Blast_Score=165, Evalue=8e-42,
Organism=Caenorhabditis elegans, GI71985061, Length=652, Percent_Identity=24.2331288343558, Blast_Score=127, Evalue=3e-29,
Organism=Caenorhabditis elegans, GI71985068, Length=617, Percent_Identity=23.9870340356564, Blast_Score=114, Evalue=2e-25,
Organism=Caenorhabditis elegans, GI17532153, Length=541, Percent_Identity=23.1053604436229, Blast_Score=89, Evalue=9e-18,
Organism=Saccharomyces cerevisiae, GI6320548, Length=612, Percent_Identity=27.6143790849673, Blast_Score=175, Evalue=2e-44,
Organism=Saccharomyces cerevisiae, GI6321883, Length=610, Percent_Identity=25.4098360655738, Blast_Score=162, Evalue=2e-40,
Organism=Drosophila melanogaster, GI18859963, Length=662, Percent_Identity=25.0755287009063, Blast_Score=127, Evalue=3e-29,
Organism=Drosophila melanogaster, GI28571570, Length=530, Percent_Identity=21.6981132075472, Blast_Score=94, Evalue=3e-19,

Paralogues:

None

Copy number: 789 Molecules/Cell In: Growth Phase, Glucose-minimal MOPS Media. 800 Molecules/Cell In: Glucose minimal media [C]

Swissprot (AC and ID): SYR_PYRFU (Q8U149)

Other databases:

- EMBL:   AE009950
- RefSeq:   NP_579109.1
- ProteinModelPortal:   Q8U149
- SMR:   Q8U149
- EnsemblBacteria:   EBPYRT00000004101
- GeneID:   1469256
- GenomeReviews:   AE009950_GR
- KEGG:   pfu:PF1380
- NMPDR:   fig|186497.1.peg.1427
- GeneTree:   EBGT00050000023242
- HOGENOM:   HBG695395
- OMA:   NDMGRQI
- ProtClustDB:   PRK01611
- BRENDA:   6.1.1.19
- GO:   GO:0005737
- HAMAP:   MF_00123
- InterPro:   IPR001412
- InterPro:   IPR001278
- InterPro:   IPR015945
- InterPro:   IPR005148
- InterPro:   IPR008909
- InterPro:   IPR014729
- InterPro:   IPR009080
- Gene3D:   G3DSA:3.30.1360.70
- Gene3D:   G3DSA:3.40.50.620
- PANTHER:   PTHR11956
- PRINTS:   PR01038
- SMART:   SM00836
- TIGRFAMs:   TIGR00456

Pfam domain/function: PF03485 Arg_tRNA_synt_N; PF05746 DALR_1; PF00750 tRNA-synt_1d; SSF55190 Arg-tRNA-synth_Ic_N; SSF47323 tRNAsyn_1a_bind

EC number: =6.1.1.19

Molecular weight: Translated: 72282; Mature: 72282

Theoretical pI: Translated: 6.60; Mature: 6.60

Prosite motif: PS00178 AA_TRNA_LIGASE_I

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.2 %Cys     (Translated Protein)
2.4 %Met     (Translated Protein)
2.5 %Cys+Met (Translated Protein)
0.2 %Cys     (Mature Protein)
2.4 %Met     (Mature Protein)
2.5 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MMETIKSEIKRTIEGIVREMAPDWSEDIQFVDTPSPELGDFGTPVAFQLARLLRKSPLII
CCHHHHHHHHHHHHHHHHHHCCCHHHCCEEECCCCCCCCCCCCCHHHHHHHHHHHCCCHH
AQEIAEKFNKNKPKEVKKAIAVNGYVNFFLDYPQISKLVIEAILGYGTEYGRSEIGKGKK
HHHHHHHHCCCCCHHHHHHHHHCCHHEEEECCHHHHHHHHHHHHHCCCCCCHHHHCCCCE
VIVEHTSVNPTKPLHMGHARNAILGDTVARILRFLGYQVEVQNYIDDLGVQFAQVYWGYL
EEEEECCCCCCCCCCCCCCCCHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHH
NLKRKFDELMKELKEKIPKNNPIDHVLGLLYVEVNKKIEESSEVEKEIRELMKKLEEREL
HHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCC
NGRKLAEEVVKAQMETLYSLNIYYDLLVWESDIVSTRLFEKTIKLLEKNENFYTPKEGKY
CHHHHHHHHHHHHHHHHHHHHHEEEEEEECHHHHHHHHHHHHHHHHHCCCCCCCCCCCCC
KGAFVMDLSKLFPDMKNPYLVLRRSDGTATYTGKDIAYHLWKFGKIDIDLMYKKWDEHTW
CCHHHHHHHHHCCCCCCCEEEEEECCCCEEECCHHHHHHHHHCCCEEEEEHHHHHCCCCC
TTAPDGEPIPGKFGAGDIVINVIGAEQRHPQLAIKYALELLGYKDAAENFHHLAYEHVES
CCCCCCCCCCCCCCCCCEEEEEECCCCCCHHHHHHHHHHHHCCHHHHHHHHHHHHHHHCC
PEGKFSGRKGTWVGFTVDEVIAEAINKAKSLIEEKNPNLTEEEKEEIAKKVAVGAIRYTL
CCCCCCCCCCCEEECCHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHH
IKYSPEKKIVFRWEDVLNFEGESAPYIQYAHARCSSILRKAEELGISTDWKSLLKVANFN
EEECCCCCEEEEEHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHCCH
QITEKERELIMLLSRFPEIVQQAGTDLKPHLIAWYANEVASTFNKFYMDHPVIKAEEGVR
HHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHCCCCEEHHCCHH
EARLLLVMATRQVLRNSLWLMGIEAPDKM
HHHHHHHHHHHHHHHCCCEEEEECCCCCC
>Mature Secondary Structure
MMETIKSEIKRTIEGIVREMAPDWSEDIQFVDTPSPELGDFGTPVAFQLARLLRKSPLII
CCHHHHHHHHHHHHHHHHHHCCCHHHCCEEECCCCCCCCCCCCCHHHHHHHHHHHCCCHH
AQEIAEKFNKNKPKEVKKAIAVNGYVNFFLDYPQISKLVIEAILGYGTEYGRSEIGKGKK
HHHHHHHHCCCCCHHHHHHHHHCCHHEEEECCHHHHHHHHHHHHHCCCCCCHHHHCCCCE
VIVEHTSVNPTKPLHMGHARNAILGDTVARILRFLGYQVEVQNYIDDLGVQFAQVYWGYL
EEEEECCCCCCCCCCCCCCCCHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHH
NLKRKFDELMKELKEKIPKNNPIDHVLGLLYVEVNKKIEESSEVEKEIRELMKKLEEREL
HHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCC
NGRKLAEEVVKAQMETLYSLNIYYDLLVWESDIVSTRLFEKTIKLLEKNENFYTPKEGKY
CHHHHHHHHHHHHHHHHHHHHHEEEEEEECHHHHHHHHHHHHHHHHHCCCCCCCCCCCCC
KGAFVMDLSKLFPDMKNPYLVLRRSDGTATYTGKDIAYHLWKFGKIDIDLMYKKWDEHTW
CCHHHHHHHHHCCCCCCCEEEEEECCCCEEECCHHHHHHHHHCCCEEEEEHHHHHCCCCC
TTAPDGEPIPGKFGAGDIVINVIGAEQRHPQLAIKYALELLGYKDAAENFHHLAYEHVES
CCCCCCCCCCCCCCCCCEEEEEECCCCCCHHHHHHHHHHHHCCHHHHHHHHHHHHHHHCC
PEGKFSGRKGTWVGFTVDEVIAEAINKAKSLIEEKNPNLTEEEKEEIAKKVAVGAIRYTL
CCCCCCCCCCCEEECCHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHH
IKYSPEKKIVFRWEDVLNFEGESAPYIQYAHARCSSILRKAEELGISTDWKSLLKVANFN
EEECCCCCEEEEEHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHCCH
QITEKERELIMLLSRFPEIVQQAGTDLKPHLIAWYANEVASTFNKFYMDHPVIKAEEGVR
HHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHCCCCEEHHCCHH
EARLLLVMATRQVLRNSLWLMGIEAPDKM
HHHHHHHHHHHHHHHCCCEEEEECCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA