| Definition | Prochlorococcus marinus str. MIT 9301, complete genome. |
|---|---|
| Accession | NC_009091 |
| Length | 1,641,879 |
Click here to switch to the map view.
The map label for this gene is argS [H]
Identifier: 126695545
GI number: 126695545
Start: 189016
End: 190830
Strand: Reverse
Name: argS [H]
Synonym: P9301_02071
Alternate gene names: 126695545
Gene position: 190830-189016 (Counterclockwise)
Preceding gene: 126695546
Following gene: 126695544
Centisome position: 11.62
GC content: 27.55
Gene sequence:
>1815_bases ATGCTAATCATTTTTAAAGAATTAACAAAACAATTTGAACAATCTCTTTTAGATAGTCTTGAAAAAAATGATAAAAAAGG AGAATTCGAAATTCTTAGAAAAAATTTAATTACACAATCATCAAAAGAGGAATTTGGTGATTATCAATGTAATGTTTGTT TAAGTTTATCTAAAATATTTAAAAAGAACCCAAGAGATATTTCTAATGATTTTATTAACCTTTTAAAAAAAAATAAAAGC ATAGCAAAATTATGTAAGAGTCTAGAAATAGCTGGACCTGGATTTATAAATATAAAATTAAAAGATGAAGTTCTAATAAA TGAAATTATATCAAATATTCAATGCAATAGGGCTGGCATACCTCTAATTAGAAAAGATTTAGATAGGGGTTTGTCTAATA AAGTTATTGTAGATTTTTCTAGTCCTAATATTGCTAAAGAAATGCATGTAGGGCATTTAAGATCAACAATAATAGGTGAC TCAATATCTAGAATTTTCGAGTTAAGAGGTTATGAAGTATTAAGACTGAATCATGTTGGTGATTGGGGGACACAATTTGG CATGCTTATTACTCAACTCAAAGATTTATATTCAAATGATCTAGAAGAAATAGGAAAGATCAAGATAAGTGATTTAGTTG AATTTTATAAAGAATCAAAAAAAAGATTTGATAACGAATCTGAATTCCAAAAAAGATCTAGAGAGGAAGTAGTTAAGTTA CAAAGTGGAGATATTAAATCGATTAAAGCTTGGAAATTATTATGTGATCAATCAAGGCAAGAATTTGATGAAATCTATAA AAATTTAAAAATAAAAATAGAAGAAAGAGGTGAATCTTTTTATAATCCCTTCTTAAAATCAGTTATTGATGATTTGAATT TAAAAAAAATATTAGTAGAAGATCAAGGAGCAAAATGTGTATTTCTAGATGGGATGACTAATAAAGAAGGCAAACCTTTA CCGCTAATTATTCAAAAAAAAGATGGAGGTTTTAATTATGCCACCACAGATCTTGCTGCTATAAGATACAGATTCAATAA ACCTCCTAATGGCGATGATGCTTCAAGAATTATTTATGTAACTGATCATGGGCAAGCAAATCATTTTGCTGGAGTTTTTC AAGTTGCAAAAAAAGCAAAATGGATACCAGAAAATTGTCAAGTAGACCATGTCCCTTTTGGGTTAGTTCAAGGAATTGAT GGCAAAAAACTAAAGACAAGAGAAGGTGAAACAATACGCCTAAAAGATTTATTAAATGAAGCAGTTAGAAGAGCAAAAGA AGATTTATTGAAAAGATTAGAAGATGAAGATCGATATGAGAACGAAGAGTTTATAGCAAATACTTCAAGAATTATTGGAT TTGGAGCTGTTAAGTATGCAGATTTAAGTCAAAATAGGATTACCAATTATCAATTTAGTTTTGATAAAATGCTTTCCCTT AATGGTAATACTGCTCCTTATTTGTTATATACACTTGTAAGAATTTTAGGAATTAAAAGAAAAAATGATTTCGTTTATGA CTCTAAAGATTTTCAGTACGTAAATTATGAAAATAAATCTGAGTGGAAACTTATCAGAAAATTACTTAAGTTCGATGAAG TTATAATTTCTATTGAAAAAGACTTAATGCCAAATAGATTATGCAATTATCTGTTCGAGCTATGTCAGACTTTTAATAGA TTCTATGATCAAGTTCCAATCCTCAAAGAAGAAAAAAATATAAAAATTTCTAGGCTTAATTTATGTGACCTAACTGCAAA AACACTAAAATTAAGCTTAGAGCTTTTAGGAATTGAAACTTTAGAAAGAATGTAA
Upstream 100 bases:
>100_bases TGATTTGATTTCAACAAGTTCTTCAATCACCAAAAGTAATTGGATTGATTTGAGTATGCGTTATATTAATTAATCATATA GATAAATAATTGAATAATTA
Downstream 100 bases:
>100_bases TGAATGATTTTGATCCATTAAATAGTCTTTTCCCAAAACCAAGAGAAGAAATAATAAATATGCAGTCTTACTCTGCACCT TTAGAAAATAGAAGAAATTT
Product: arginyl-tRNA synthetase
Products: NA
Alternate protein names: Arginine--tRNA ligase; ArgRS [H]
Number of amino acids: Translated: 604; Mature: 604
Protein sequence:
>604_residues MLIIFKELTKQFEQSLLDSLEKNDKKGEFEILRKNLITQSSKEEFGDYQCNVCLSLSKIFKKNPRDISNDFINLLKKNKS IAKLCKSLEIAGPGFINIKLKDEVLINEIISNIQCNRAGIPLIRKDLDRGLSNKVIVDFSSPNIAKEMHVGHLRSTIIGD SISRIFELRGYEVLRLNHVGDWGTQFGMLITQLKDLYSNDLEEIGKIKISDLVEFYKESKKRFDNESEFQKRSREEVVKL QSGDIKSIKAWKLLCDQSRQEFDEIYKNLKIKIEERGESFYNPFLKSVIDDLNLKKILVEDQGAKCVFLDGMTNKEGKPL PLIIQKKDGGFNYATTDLAAIRYRFNKPPNGDDASRIIYVTDHGQANHFAGVFQVAKKAKWIPENCQVDHVPFGLVQGID GKKLKTREGETIRLKDLLNEAVRRAKEDLLKRLEDEDRYENEEFIANTSRIIGFGAVKYADLSQNRITNYQFSFDKMLSL NGNTAPYLLYTLVRILGIKRKNDFVYDSKDFQYVNYENKSEWKLIRKLLKFDEVIISIEKDLMPNRLCNYLFELCQTFNR FYDQVPILKEEKNIKISRLNLCDLTAKTLKLSLELLGIETLERM
Sequences:
>Translated_604_residues MLIIFKELTKQFEQSLLDSLEKNDKKGEFEILRKNLITQSSKEEFGDYQCNVCLSLSKIFKKNPRDISNDFINLLKKNKS IAKLCKSLEIAGPGFINIKLKDEVLINEIISNIQCNRAGIPLIRKDLDRGLSNKVIVDFSSPNIAKEMHVGHLRSTIIGD SISRIFELRGYEVLRLNHVGDWGTQFGMLITQLKDLYSNDLEEIGKIKISDLVEFYKESKKRFDNESEFQKRSREEVVKL QSGDIKSIKAWKLLCDQSRQEFDEIYKNLKIKIEERGESFYNPFLKSVIDDLNLKKILVEDQGAKCVFLDGMTNKEGKPL PLIIQKKDGGFNYATTDLAAIRYRFNKPPNGDDASRIIYVTDHGQANHFAGVFQVAKKAKWIPENCQVDHVPFGLVQGID GKKLKTREGETIRLKDLLNEAVRRAKEDLLKRLEDEDRYENEEFIANTSRIIGFGAVKYADLSQNRITNYQFSFDKMLSL NGNTAPYLLYTLVRILGIKRKNDFVYDSKDFQYVNYENKSEWKLIRKLLKFDEVIISIEKDLMPNRLCNYLFELCQTFNR FYDQVPILKEEKNIKISRLNLCDLTAKTLKLSLELLGIETLERM >Mature_604_residues MLIIFKELTKQFEQSLLDSLEKNDKKGEFEILRKNLITQSSKEEFGDYQCNVCLSLSKIFKKNPRDISNDFINLLKKNKS IAKLCKSLEIAGPGFINIKLKDEVLINEIISNIQCNRAGIPLIRKDLDRGLSNKVIVDFSSPNIAKEMHVGHLRSTIIGD SISRIFELRGYEVLRLNHVGDWGTQFGMLITQLKDLYSNDLEEIGKIKISDLVEFYKESKKRFDNESEFQKRSREEVVKL QSGDIKSIKAWKLLCDQSRQEFDEIYKNLKIKIEERGESFYNPFLKSVIDDLNLKKILVEDQGAKCVFLDGMTNKEGKPL PLIIQKKDGGFNYATTDLAAIRYRFNKPPNGDDASRIIYVTDHGQANHFAGVFQVAKKAKWIPENCQVDHVPFGLVQGID GKKLKTREGETIRLKDLLNEAVRRAKEDLLKRLEDEDRYENEEFIANTSRIIGFGAVKYADLSQNRITNYQFSFDKMLSL NGNTAPYLLYTLVRILGIKRKNDFVYDSKDFQYVNYENKSEWKLIRKLLKFDEVIISIEKDLMPNRLCNYLFELCQTFNR FYDQVPILKEEKNIKISRLNLCDLTAKTLKLSLELLGIETLERM
Specific function: Unknown
COG id: COG0018
COG function: function code J; Arginyl-tRNA synthetase
Gene ontology:
Cell location: Cytoplasm [H]
Metaboloic importance: Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the class-I aminoacyl-tRNA synthetase family [H]
Homologues:
Organism=Homo sapiens, GI15149476, Length=587, Percent_Identity=43.7819420783646, Blast_Score=453, Evalue=1e-127, Organism=Homo sapiens, GI197100773, Length=585, Percent_Identity=31.6239316239316, Blast_Score=234, Evalue=2e-61, Organism=Escherichia coli, GI1788184, Length=572, Percent_Identity=41.6083916083916, Blast_Score=452, Evalue=1e-128, Organism=Caenorhabditis elegans, GI71985061, Length=591, Percent_Identity=39.9323181049069, Blast_Score=398, Evalue=1e-111, Organism=Caenorhabditis elegans, GI71985068, Length=559, Percent_Identity=40.7871198568873, Blast_Score=379, Evalue=1e-105, Organism=Caenorhabditis elegans, GI17532153, Length=503, Percent_Identity=25.844930417495, Blast_Score=138, Evalue=9e-33, Organism=Saccharomyces cerevisiae, GI6320548, Length=568, Percent_Identity=30.4577464788732, Blast_Score=214, Evalue=4e-56, Organism=Saccharomyces cerevisiae, GI6321883, Length=572, Percent_Identity=29.020979020979, Blast_Score=203, Evalue=7e-53, Organism=Drosophila melanogaster, GI18859963, Length=580, Percent_Identity=43.1034482758621, Blast_Score=439, Evalue=1e-123, Organism=Drosophila melanogaster, GI28571570, Length=520, Percent_Identity=29.2307692307692, Blast_Score=194, Evalue=2e-49,
Paralogues:
None
Copy number: 789 Molecules/Cell In: Growth Phase, Glucose-minimal MOPS Media. 800 Molecules/Cell In: Glucose minimal media [C]
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR001412 - InterPro: IPR001278 - InterPro: IPR015945 - InterPro: IPR005148 - InterPro: IPR008909 - InterPro: IPR014729 - InterPro: IPR009080 [H]
Pfam domain/function: PF03485 Arg_tRNA_synt_N; PF05746 DALR_1; PF00750 tRNA-synt_1d [H]
EC number: =6.1.1.19 [H]
Molecular weight: Translated: 70029; Mature: 70029
Theoretical pI: Translated: 8.82; Mature: 8.82
Prosite motif: PS00178 AA_TRNA_LIGASE_I
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.7 %Cys (Translated Protein) 1.2 %Met (Translated Protein) 2.8 %Cys+Met (Translated Protein) 1.7 %Cys (Mature Protein) 1.2 %Met (Mature Protein) 2.8 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MLIIFKELTKQFEQSLLDSLEKNDKKGEFEILRKNLITQSSKEEFGDYQCNVCLSLSKIF CEEEHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHCCCCHHHCCCCEEHHHHHHHHHH KKNPRDISNDFINLLKKNKSIAKLCKSLEIAGPGFINIKLKDEVLINEIISNIQCNRAGI CCCCCCHHHHHHHHHHCCCHHHHHHHHCCCCCCCEEEEEECHHHHHHHHHHHCCCCCCCC PLIRKDLDRGLSNKVIVDFSSPNIAKEMHVGHLRSTIIGDSISRIFELRGYEVLRLNHVG HHHHHHHHCCCCCCEEEEECCCCHHHHHHHHHHHHHHHHHHHHHHHHHCCCEEEEEECCC DWGTQFGMLITQLKDLYSNDLEEIGKIKISDLVEFYKESKKRFDNESEFQKRSREEVVKL CHHHHHHHHHHHHHHHHHHHHHHHHCEEHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHH QSGDIKSIKAWKLLCDQSRQEFDEIYKNLKIKIEERGESFYNPFLKSVIDDLNLKKILVE CCCCCCHHHHHHHHHHHHHHHHHHHHHCCEEEEECCCCHHHHHHHHHHHCCCCCEEEEEE DQGAKCVFLDGMTNKEGKPLPLIIQKKDGGFNYATTDLAAIRYRFNKPPNGDDASRIIYV CCCCEEEEECCCCCCCCCCCEEEEEECCCCCCCHHHHHHHHHEECCCCCCCCCCCEEEEE TDHGQANHFAGVFQVAKKAKWIPENCQVDHVPFGLVQGIDGKKLKTREGETIRLKDLLNE ECCCCCCHHHHHHHHHHHCCCCCCCCCCCCCCHHHHCCCCCCCEECCCCCEEEHHHHHHH AVRRAKEDLLKRLEDEDRYENEEFIANTSRIIGFGAVKYADLSQNRITNYQFSFDKMLSL HHHHHHHHHHHHCCHHHCCCCHHHHHCCHHHEEECCEEEECCCCCCCCCEEECHHHHEEC NGNTAPYLLYTLVRILGIKRKNDFVYDSKDFQYVNYENKSEWKLIRKLLKFDEVIISIEK CCCCHHHHHHHHHHHHCCCCCCCCEECCCCCEEECCCCCHHHHHHHHHHHHHHHHHHHHH DLMPNRLCNYLFELCQTFNRFYDQVPILKEEKNIKISRLNLCDLTAKTLKLSLELLGIET HCCHHHHHHHHHHHHHHHHHHHHCCCCEECCCCCEEEEECHHHHHHHHHHHHHHHHHHHH LERM HHCC >Mature Secondary Structure MLIIFKELTKQFEQSLLDSLEKNDKKGEFEILRKNLITQSSKEEFGDYQCNVCLSLSKIF CEEEHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHCCCCHHHCCCCEEHHHHHHHHHH KKNPRDISNDFINLLKKNKSIAKLCKSLEIAGPGFINIKLKDEVLINEIISNIQCNRAGI CCCCCCHHHHHHHHHHCCCHHHHHHHHCCCCCCCEEEEEECHHHHHHHHHHHCCCCCCCC PLIRKDLDRGLSNKVIVDFSSPNIAKEMHVGHLRSTIIGDSISRIFELRGYEVLRLNHVG HHHHHHHHCCCCCCEEEEECCCCHHHHHHHHHHHHHHHHHHHHHHHHHCCCEEEEEECCC DWGTQFGMLITQLKDLYSNDLEEIGKIKISDLVEFYKESKKRFDNESEFQKRSREEVVKL CHHHHHHHHHHHHHHHHHHHHHHHHCEEHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHH QSGDIKSIKAWKLLCDQSRQEFDEIYKNLKIKIEERGESFYNPFLKSVIDDLNLKKILVE CCCCCCHHHHHHHHHHHHHHHHHHHHHCCEEEEECCCCHHHHHHHHHHHCCCCCEEEEEE DQGAKCVFLDGMTNKEGKPLPLIIQKKDGGFNYATTDLAAIRYRFNKPPNGDDASRIIYV CCCCEEEEECCCCCCCCCCCEEEEEECCCCCCCHHHHHHHHHEECCCCCCCCCCCEEEEE TDHGQANHFAGVFQVAKKAKWIPENCQVDHVPFGLVQGIDGKKLKTREGETIRLKDLLNE ECCCCCCHHHHHHHHHHHCCCCCCCCCCCCCCHHHHCCCCCCCEECCCCCEEEHHHHHHH AVRRAKEDLLKRLEDEDRYENEEFIANTSRIIGFGAVKYADLSQNRITNYQFSFDKMLSL HHHHHHHHHHHHCCHHHCCCCHHHHHCCHHHEEECCEEEECCCCCCCCCEEECHHHHEEC NGNTAPYLLYTLVRILGIKRKNDFVYDSKDFQYVNYENKSEWKLIRKLLKFDEVIISIEK CCCCHHHHHHHHHHHHCCCCCCCCEECCCCCEEECCCCCHHHHHHHHHHHHHHHHHHHHH DLMPNRLCNYLFELCQTFNRFYDQVPILKEEKNIKISRLNLCDLTAKTLKLSLELLGIET HCCHHHHHHHHHHHHHHHHHHHHCCCCEECCCCCEEEEECHHHHHHHHHHHHHHHHHHHH LERM HHCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: NA