Definition Prochlorococcus marinus str. MIT 9301, complete genome.
Accession NC_009091
Length 1,641,879

Click here to switch to the map view.

The map label for this gene is lysS

Identifier: 126697148

GI number: 126697148

Start: 1531823

End: 1533361

Strand: Reverse

Name: lysS

Synonym: P9301_18101

Alternate gene names: 126697148

Gene position: 1533361-1531823 (Counterclockwise)

Preceding gene: 126697149

Following gene: 126697147

Centisome position: 93.39

GC content: 31.9

Gene sequence:

>1539_bases
TTGTCTGAAATAAAAGAAGCACGCTTACAAAAAGCTAGTTCACTCGTTAGTAAAGGTTTTGCTTCTTACGCGCAGAGTTT
TAGGGTATCACATACTACCAGTTTTCTTATTCAAAAATTTGATTATTTAGAAAATGGTCAAGAGGAAAACTTCAGTGTTT
CTCTGGCTGGTAGAGTAATGGCAAAAAGGGTAATGGGTAAAATTGCCTTTTTTACAATAAGCGATCAGGATGGCCAGATT
CAGCTTTATCTAGAAAAAAGGATTATTAATTTAAATTTAGAAAAACAAAAATTACTCTCTTTTGAAGATATCAAGGAAAT
AGTAGACATTGGTGATTGGATAGGCGTATACGGAACTATTAAAAAAACTAATAAAGGCGAGCTTTCAATTAAAGTAGAAA
AATGGGAAATGTTATCGAAATCATTACAACCATTGCCAGATAAATGGCATGGATTGACCGATATTGAAAAAAGATATAGA
CAACGTTATCTAGATTTAATAGTGAATCCTCACTCTAAAAATGTATTTAAAACAAGAGCAAAATGTATAAGTTTTATAAG
AAAATGGTTAGATAATAGAAATTTTTTAGAGATAGAGACTCCAATTCTGCAATCTGAAGCTGGTGGTGCCGAAGCAAGAC
CATTTATAACTCATCACAATACCTTAGATATTCCGCTTTATCTAAGAATAGCGACAGAATTACATTTAAAAAGAATGGTT
GTTGGAGGATTTGAGAAAGTATATGAATTAGGAAGAATCTTTCGTAATGAGGGGATAAGTACAAGACATAATCCTGAATT
CACCTCAGTTGAAATTTATGAAGCTTATTCTGATTATGTCGATATGATGAATTTAACTGAAGAATTGATTAAAGATATTC
TAGCTGATGCCTGTGGGTCTTTAACTATAAATTATCAAAATAAAGAAATTGATTTTTCAAAACCTTGGTTAAGAATATCC
ATGAAAGATATTGTCAAAAAATATACAGGGATTGATTTTCATTCTTTCAACGGAGACTTTCTAGCAGCAAAAAAAGCCGT
TAAAAATATAAATGTTGATTTCTCTAATAAAGTAAATACTATTGGAAGACTTTTAAATGAGGTCTTCGAGCAAAAAGTTG
AATCAAAACTTATAGAACCCACTTTTGTTATCGATTATCCTGTTGAAATTTCTCCTTTAGCTAGGCCTCATTTTGATAAT
AAAGAAATAGTTCAGAGATTTGAACTATTCATTGTTGGTCGAGAGCTGGCAAATGCGTTTAGTGAGTTAATAGATCCAGT
CGATCAAAGAGAAAGAATGCAATTACAGCAATCTCTTAGAGATAAAGGAGATCTGGAGGCTCACTGTATAGATGAAGATT
TCTTGAATGCTTTAGAGATTGGTATGCCGCCTACTGGAGGATTAGGCATAGGCATTGATAGATTAATTATGTTAATTACT
AACAGCGCATCGATTAGAGATGTAATCCCTTTCCCATTGTTAAAACCAGAAATATCTTCCAAAAAAAGTGAAAAATTACC
CTTGAATGAAGTAAAATAG

Upstream 100 bases:

>100_bases
GTTACGCATCCCAGAGAGTTGGTGAAACAGCAACATCTTTGGCAAGTTGAGCCATAGTTTGATAATTTTATTAAATAAAA
CAAATATATTTAAATAAATT

Downstream 100 bases:

>100_bases
ATAAATTATTCCAATACGAAATTTTTTAAATGAGTGGTGAACGTGTTGGTTTCCGTTTCAAACATGCGGATGCAGTAGTA
AAAAGAAATCCTCAAGGCCG

Product: lysyl-tRNA synthetase

Products: NA

Alternate protein names: Lysine--tRNA ligase; LysRS

Number of amino acids: Translated: 512; Mature: 511

Protein sequence:

>512_residues
MSEIKEARLQKASSLVSKGFASYAQSFRVSHTTSFLIQKFDYLENGQEENFSVSLAGRVMAKRVMGKIAFFTISDQDGQI
QLYLEKRIINLNLEKQKLLSFEDIKEIVDIGDWIGVYGTIKKTNKGELSIKVEKWEMLSKSLQPLPDKWHGLTDIEKRYR
QRYLDLIVNPHSKNVFKTRAKCISFIRKWLDNRNFLEIETPILQSEAGGAEARPFITHHNTLDIPLYLRIATELHLKRMV
VGGFEKVYELGRIFRNEGISTRHNPEFTSVEIYEAYSDYVDMMNLTEELIKDILADACGSLTINYQNKEIDFSKPWLRIS
MKDIVKKYTGIDFHSFNGDFLAAKKAVKNINVDFSNKVNTIGRLLNEVFEQKVESKLIEPTFVIDYPVEISPLARPHFDN
KEIVQRFELFIVGRELANAFSELIDPVDQRERMQLQQSLRDKGDLEAHCIDEDFLNALEIGMPPTGGLGIGIDRLIMLIT
NSASIRDVIPFPLLKPEISSKKSEKLPLNEVK

Sequences:

>Translated_512_residues
MSEIKEARLQKASSLVSKGFASYAQSFRVSHTTSFLIQKFDYLENGQEENFSVSLAGRVMAKRVMGKIAFFTISDQDGQI
QLYLEKRIINLNLEKQKLLSFEDIKEIVDIGDWIGVYGTIKKTNKGELSIKVEKWEMLSKSLQPLPDKWHGLTDIEKRYR
QRYLDLIVNPHSKNVFKTRAKCISFIRKWLDNRNFLEIETPILQSEAGGAEARPFITHHNTLDIPLYLRIATELHLKRMV
VGGFEKVYELGRIFRNEGISTRHNPEFTSVEIYEAYSDYVDMMNLTEELIKDILADACGSLTINYQNKEIDFSKPWLRIS
MKDIVKKYTGIDFHSFNGDFLAAKKAVKNINVDFSNKVNTIGRLLNEVFEQKVESKLIEPTFVIDYPVEISPLARPHFDN
KEIVQRFELFIVGRELANAFSELIDPVDQRERMQLQQSLRDKGDLEAHCIDEDFLNALEIGMPPTGGLGIGIDRLIMLIT
NSASIRDVIPFPLLKPEISSKKSEKLPLNEVK
>Mature_511_residues
SEIKEARLQKASSLVSKGFASYAQSFRVSHTTSFLIQKFDYLENGQEENFSVSLAGRVMAKRVMGKIAFFTISDQDGQIQ
LYLEKRIINLNLEKQKLLSFEDIKEIVDIGDWIGVYGTIKKTNKGELSIKVEKWEMLSKSLQPLPDKWHGLTDIEKRYRQ
RYLDLIVNPHSKNVFKTRAKCISFIRKWLDNRNFLEIETPILQSEAGGAEARPFITHHNTLDIPLYLRIATELHLKRMVV
GGFEKVYELGRIFRNEGISTRHNPEFTSVEIYEAYSDYVDMMNLTEELIKDILADACGSLTINYQNKEIDFSKPWLRISM
KDIVKKYTGIDFHSFNGDFLAAKKAVKNINVDFSNKVNTIGRLLNEVFEQKVESKLIEPTFVIDYPVEISPLARPHFDNK
EIVQRFELFIVGRELANAFSELIDPVDQRERMQLQQSLRDKGDLEAHCIDEDFLNALEIGMPPTGGLGIGIDRLIMLITN
SASIRDVIPFPLLKPEISSKKSEKLPLNEVK

Specific function: Unknown

COG id: COG1190

COG function: function code J; Lysyl-tRNA synthetase (class II)

Gene ontology:

Cell location: Cytoplasm

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the class-II aminoacyl-tRNA synthetase family

Homologues:

Organism=Homo sapiens, GI5031815, Length=503, Percent_Identity=40.7554671968191, Blast_Score=362, Evalue=1e-100,
Organism=Homo sapiens, GI194272210, Length=503, Percent_Identity=40.7554671968191, Blast_Score=361, Evalue=1e-100,
Organism=Homo sapiens, GI226491502, Length=338, Percent_Identity=24.8520710059172, Blast_Score=85, Evalue=2e-16,
Organism=Homo sapiens, GI45439306, Length=481, Percent_Identity=22.4532224532225, Blast_Score=81, Evalue=2e-15,
Organism=Escherichia coli, GI1789256, Length=493, Percent_Identity=47.6673427991886, Blast_Score=466, Evalue=1e-132,
Organism=Escherichia coli, GI1790571, Length=492, Percent_Identity=47.9674796747967, Blast_Score=464, Evalue=1e-132,
Organism=Escherichia coli, GI87082379, Length=328, Percent_Identity=31.7073170731707, Blast_Score=152, Evalue=4e-38,
Organism=Escherichia coli, GI1788173, Length=335, Percent_Identity=24.1791044776119, Blast_Score=89, Evalue=9e-19,
Organism=Caenorhabditis elegans, GI17535925, Length=509, Percent_Identity=40.4715127701375, Blast_Score=375, Evalue=1e-104,
Organism=Caenorhabditis elegans, GI17535927, Length=509, Percent_Identity=40.4715127701375, Blast_Score=375, Evalue=1e-104,
Organism=Caenorhabditis elegans, GI71994340, Length=509, Percent_Identity=40.4715127701375, Blast_Score=374, Evalue=1e-104,
Organism=Caenorhabditis elegans, GI17551876, Length=480, Percent_Identity=23.75, Blast_Score=86, Evalue=7e-17,
Organism=Caenorhabditis elegans, GI32566633, Length=315, Percent_Identity=23.8095238095238, Blast_Score=66, Evalue=4e-11,
Organism=Saccharomyces cerevisiae, GI6320242, Length=501, Percent_Identity=41.5169660678643, Blast_Score=375, Evalue=1e-105,
Organism=Saccharomyces cerevisiae, GI6324256, Length=489, Percent_Identity=31.6973415132924, Blast_Score=210, Evalue=6e-55,
Organism=Saccharomyces cerevisiae, GI6321807, Length=463, Percent_Identity=23.7580993520518, Blast_Score=77, Evalue=9e-15,
Organism=Drosophila melanogaster, GI24640849, Length=498, Percent_Identity=40.7630522088353, Blast_Score=367, Evalue=1e-102,
Organism=Drosophila melanogaster, GI24640851, Length=498, Percent_Identity=40.7630522088353, Blast_Score=367, Evalue=1e-101,
Organism=Drosophila melanogaster, GI17136276, Length=484, Percent_Identity=23.9669421487603, Blast_Score=89, Evalue=1e-17,
Organism=Drosophila melanogaster, GI24584738, Length=338, Percent_Identity=24.2603550295858, Blast_Score=69, Evalue=8e-12,

Paralogues:

None

Copy number: 1200 Molecules/Cell In: Glucose minimal media [C]

Swissprot (AC and ID): SYK_PROM0 (A3PFA8)

Other databases:

- EMBL:   CP000576
- RefSeq:   YP_001092034.1
- ProteinModelPortal:   A3PFA8
- SMR:   A3PFA8
- STRING:   A3PFA8
- GeneID:   4911514
- GenomeReviews:   CP000576_GR
- KEGG:   pmg:P9301_18101
- eggNOG:   COG1190
- HOGENOM:   HBG631383
- OMA:   RNEGMDH
- ProtClustDB:   PRK00484
- BioCyc:   PMAR167546:P9301ORF_1849-MONOMER
- GO:   GO:0005737
- HAMAP:   MF_00252
- InterPro:   IPR004364
- InterPro:   IPR018150
- InterPro:   IPR006195
- InterPro:   IPR002313
- InterPro:   IPR018149
- InterPro:   IPR012340
- InterPro:   IPR016027
- InterPro:   IPR004365
- Gene3D:   G3DSA:2.40.50.140
- PANTHER:   PTHR22594
- PANTHER:   PTHR22594:SF4
- PRINTS:   PR00982
- TIGRFAMs:   TIGR00499

Pfam domain/function: PF00152 tRNA-synt_2; PF01336 tRNA_anti; SSF50249 Nucleic_acid_OB

EC number: =6.1.1.6

Molecular weight: Translated: 58852; Mature: 58720

Theoretical pI: Translated: 6.87; Mature: 6.87

Prosite motif: PS50862 AA_TRNA_LIGASE_II

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.6 %Cys     (Translated Protein)
2.1 %Met     (Translated Protein)
2.7 %Cys+Met (Translated Protein)
0.6 %Cys     (Mature Protein)
2.0 %Met     (Mature Protein)
2.5 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSEIKEARLQKASSLVSKGFASYAQSFRVSHTTSFLIQKFDYLENGQEENFSVSLAGRVM
CCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCEEEEHHHHHH
AKRVMGKIAFFTISDQDGQIQLYLEKRIINLNLEKQKLLSFEDIKEIVDIGDWIGVYGTI
HHHHHHHEEEEEEECCCCEEEEEEEEEEEECCCCHHHHCCHHHHHHHHHHHHHHHHCEEE
KKTNKGELSIKVEKWEMLSKSLQPLPDKWHGLTDIEKRYRQRYLDLIVNPHSKNVFKTRA
EECCCCCEEEEEHHHHHHHHHCCCCCHHHCCCHHHHHHHHHHHHHHHCCCCCCHHHHHHH
KCISFIRKWLDNRNFLEIETPILQSEAGGAEARPFITHHNTLDIPLYLRIATELHLKRMV
HHHHHHHHHHCCCCEEEEECCHHHCCCCCCCCCCEEEECCCCCCEEEEEHHHHHHHHHHH
VGGFEKVYELGRIFRNEGISTRHNPEFTSVEIYEAYSDYVDMMNLTEELIKDILADACGS
HHHHHHHHHHHHHHHHCCCCCCCCCCCCEEEHHHHHHHHHHHHHHHHHHHHHHHHHCCCC
LTINYQNKEIDFSKPWLRISMKDIVKKYTGIDFHSFNGDFLAAKKAVKNINVDFSNKVNT
EEEEECCCCCCCCCCHHEEEHHHHHHHHCCCCEECCCCCHHHHHHHHHHCCCCCCHHHHH
IGRLLNEVFEQKVESKLIEPTFVIDYPVEISPLARPHFDNKEIVQRFELFIVGRELANAF
HHHHHHHHHHHHHHHHHCCCEEEEECCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHH
SELIDPVDQRERMQLQQSLRDKGDLEAHCIDEDFLNALEIGMPPTGGLGIGIDRLIMLIT
HHHHCCCCHHHHHHHHHHHCCCCCCCEEECCHHHHHHHHCCCCCCCCCCCCHHHHHHHHC
NSASIRDVIPFPLLKPEISSKKSEKLPLNEVK
CCCCCHHCCCCCCCCCCCCCCCCCCCCCCCCC
>Mature Secondary Structure 
SEIKEARLQKASSLVSKGFASYAQSFRVSHTTSFLIQKFDYLENGQEENFSVSLAGRVM
CHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCEEEEHHHHHH
AKRVMGKIAFFTISDQDGQIQLYLEKRIINLNLEKQKLLSFEDIKEIVDIGDWIGVYGTI
HHHHHHHEEEEEEECCCCEEEEEEEEEEEECCCCHHHHCCHHHHHHHHHHHHHHHHCEEE
KKTNKGELSIKVEKWEMLSKSLQPLPDKWHGLTDIEKRYRQRYLDLIVNPHSKNVFKTRA
EECCCCCEEEEEHHHHHHHHHCCCCCHHHCCCHHHHHHHHHHHHHHHCCCCCCHHHHHHH
KCISFIRKWLDNRNFLEIETPILQSEAGGAEARPFITHHNTLDIPLYLRIATELHLKRMV
HHHHHHHHHHCCCCEEEEECCHHHCCCCCCCCCCEEEECCCCCCEEEEEHHHHHHHHHHH
VGGFEKVYELGRIFRNEGISTRHNPEFTSVEIYEAYSDYVDMMNLTEELIKDILADACGS
HHHHHHHHHHHHHHHHCCCCCCCCCCCCEEEHHHHHHHHHHHHHHHHHHHHHHHHHCCCC
LTINYQNKEIDFSKPWLRISMKDIVKKYTGIDFHSFNGDFLAAKKAVKNINVDFSNKVNT
EEEEECCCCCCCCCCHHEEEHHHHHHHHCCCCEECCCCCHHHHHHHHHHCCCCCCHHHHH
IGRLLNEVFEQKVESKLIEPTFVIDYPVEISPLARPHFDNKEIVQRFELFIVGRELANAF
HHHHHHHHHHHHHHHHHCCCEEEEECCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHH
SELIDPVDQRERMQLQQSLRDKGDLEAHCIDEDFLNALEIGMPPTGGLGIGIDRLIMLIT
HHHHCCCCHHHHHHHHHHHCCCCCCCEEECCHHHHHHHHCCCCCCCCCCCCHHHHHHHHC
NSASIRDVIPFPLLKPEISSKKSEKLPLNEVK
CCCCCHHCCCCCCCCCCCCCCCCCCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA