Definition Desulfurococcus kamchatkensis 1221n chromosome, complete genome.
Accession NC_011766
Length 1,365,223

Click here to switch to the map view.

The map label for this gene is pheS [H]

Identifier: 218883548

GI number: 218883548

Start: 219610

End: 221172

Strand: Direct

Name: pheS [H]

Synonym: DKAM_0237

Alternate gene names: 218883548

Gene position: 219610-221172 (Clockwise)

Preceding gene: 218883546

Following gene: 218883549

Centisome position: 16.09

GC content: 45.04

Gene sequence:

>1563_bases
ATGGGTGGTGAGGAGTGCTTGAGTAGACCGGTGTTTCTATCACCTAGGCAGTATAGAATAGTATCTATATTAGTGGAGAA
GAAGGCCATAGACATTAATACTCTTGCTCAATTAATTGAAGGCAGGCCAGAAGATTTGATGAGGGATCTCGCTGAACTAG
AGGGAAGGAAGTTAATTAGAATTCTTAAGCAGGCGGTGAAAATACCTGTTTTAACAAGTGAGGCATACTTCTACCTGGAG
AAGGGGATGCCAGAGGAACAAGTGTATAGGGTGCTCGGTAAGTGTGTTAATAAACCGCTCAATGAGTTTATTCAGTGCAT
TAGAGAACATACAGGTATACCAGAGGAAATAGTAAAGATAGGGTTGCAGTACCATTTGAAGTCGAAGTGCCTGGTGGTCT
TGAATGGCATAGTTGCCAAGGGGGAGGAAGAAAAGTGTATTGAATTGATGAAAAGTGCTGAGGAAGTTAAGAGGAAACTC
GAGTTGATCAGGGATAAGGGCGAGATGCCCTCCGACACAGAGTTACTTAGAAGGAGGCATCTAATAGAGTTGAGGGATAG
GACGAGTATCACTGTATTGCCGATGCCGGAGCTCTTAGACCTCTATAGGAATGGATTGGTAAGGGAAAAAGAGGTATTAA
CCATAGTAAAACCAGCCCTAACCCCCACACTAGATCAATACATTATAAAGGAATTCGATCTCTCAATAGAACCTCCTGCC
ATACCTTTGGCTAGAAAGCACCCCTTTATGGAGTTTATAGATGATCTAAGGGATATCCTAACATCGATGGGTTTCGAAGA
GGTTAAAGGACCCCATGTAGAGGCTGAGTTCTGGAATTTCGACGTCCTATTTCAAGCACAGGATCACCCGGCTAGGGAGA
TACATGATACATTCTTCCTGAAGACTGATCTACGGGCTAAGATACCTGCTTGGCTCCTTGAGAGGGCTGGTAGGATACAT
GAAGAAGGATGGAGGTATAAGTGGAGTCCTGAGAGATCTCTAAGATTAGTCTTAAGGAGCCAGACAACGGCTGTTTCTGC
TAGAGCTATATATGAGAGGGGAGAGGGTGAGTACAGGGTTTTCACGATAGATAGGAACTTCAGACCCGAGAACCTTGACG
CTAAGCACAGTATGGAGTTCCACCAGTTGGATGGGGTGATCGTGGGCAGGGATGTTAACTTCAAGCACCTTCTATATTTC
TTCAAGGAGCTTGCAGCAGCCTTAGGGATAAAGGAGGTCTGGTTTAAACCAGGTTACTTCCCCTTTACTGAGCCAAGTGT
TGAAGGATATATTAAACACCCGAGACTTGGATGGGTTGAGGTGTTCCCCGGGGGTGTTTTCCGACCTGAGGTCATGAATA
TTCTTGGAGCACCGGGTGTTAGGGCTGTTGCATGGGGTATAGGTGTAGACAGGCTGGCTATGACTGTGCTGGGCTTAAAC
GATATCAGGCTATTATTTACCAGGGATCTCGACGTGTTGGAGAACATCAAGTATAATGGACTACCATTCTTTAAGTCGAG
AACAACCGGTAAAGAGGTAAGGGTTGTAGAGTACCCATACTAG

Upstream 100 bases:

>100_bases
ACCGAGGCAAAGCAATTAAAAATATTTAGAGGTAATTAAATAACGACGAACAGACCTAAACCCTCTGACATCTTAAGGGT
GAGTGTATTAAACGTTCACC

Downstream 100 bases:

>100_bases
GTAAGGGTTCAGTCTTCATGAGGTTTTTCACATCATTCTTCTACGGTATACACCCGAGTAAATGCTATGGCTACATAGTG
AACATAGATCCCCTTCTCCC

Product: phenylalanyl-tRNA synthetase subunit alpha

Products: NA

Alternate protein names: Phenylalanine--tRNA ligase alpha chain; PheRS [H]

Number of amino acids: Translated: 520; Mature: 519

Protein sequence:

>520_residues
MGGEECLSRPVFLSPRQYRIVSILVEKKAIDINTLAQLIEGRPEDLMRDLAELEGRKLIRILKQAVKIPVLTSEAYFYLE
KGMPEEQVYRVLGKCVNKPLNEFIQCIREHTGIPEEIVKIGLQYHLKSKCLVVLNGIVAKGEEEKCIELMKSAEEVKRKL
ELIRDKGEMPSDTELLRRRHLIELRDRTSITVLPMPELLDLYRNGLVREKEVLTIVKPALTPTLDQYIIKEFDLSIEPPA
IPLARKHPFMEFIDDLRDILTSMGFEEVKGPHVEAEFWNFDVLFQAQDHPAREIHDTFFLKTDLRAKIPAWLLERAGRIH
EEGWRYKWSPERSLRLVLRSQTTAVSARAIYERGEGEYRVFTIDRNFRPENLDAKHSMEFHQLDGVIVGRDVNFKHLLYF
FKELAAALGIKEVWFKPGYFPFTEPSVEGYIKHPRLGWVEVFPGGVFRPEVMNILGAPGVRAVAWGIGVDRLAMTVLGLN
DIRLLFTRDLDVLENIKYNGLPFFKSRTTGKEVRVVEYPY

Sequences:

>Translated_520_residues
MGGEECLSRPVFLSPRQYRIVSILVEKKAIDINTLAQLIEGRPEDLMRDLAELEGRKLIRILKQAVKIPVLTSEAYFYLE
KGMPEEQVYRVLGKCVNKPLNEFIQCIREHTGIPEEIVKIGLQYHLKSKCLVVLNGIVAKGEEEKCIELMKSAEEVKRKL
ELIRDKGEMPSDTELLRRRHLIELRDRTSITVLPMPELLDLYRNGLVREKEVLTIVKPALTPTLDQYIIKEFDLSIEPPA
IPLARKHPFMEFIDDLRDILTSMGFEEVKGPHVEAEFWNFDVLFQAQDHPAREIHDTFFLKTDLRAKIPAWLLERAGRIH
EEGWRYKWSPERSLRLVLRSQTTAVSARAIYERGEGEYRVFTIDRNFRPENLDAKHSMEFHQLDGVIVGRDVNFKHLLYF
FKELAAALGIKEVWFKPGYFPFTEPSVEGYIKHPRLGWVEVFPGGVFRPEVMNILGAPGVRAVAWGIGVDRLAMTVLGLN
DIRLLFTRDLDVLENIKYNGLPFFKSRTTGKEVRVVEYPY
>Mature_519_residues
GGEECLSRPVFLSPRQYRIVSILVEKKAIDINTLAQLIEGRPEDLMRDLAELEGRKLIRILKQAVKIPVLTSEAYFYLEK
GMPEEQVYRVLGKCVNKPLNEFIQCIREHTGIPEEIVKIGLQYHLKSKCLVVLNGIVAKGEEEKCIELMKSAEEVKRKLE
LIRDKGEMPSDTELLRRRHLIELRDRTSITVLPMPELLDLYRNGLVREKEVLTIVKPALTPTLDQYIIKEFDLSIEPPAI
PLARKHPFMEFIDDLRDILTSMGFEEVKGPHVEAEFWNFDVLFQAQDHPAREIHDTFFLKTDLRAKIPAWLLERAGRIHE
EGWRYKWSPERSLRLVLRSQTTAVSARAIYERGEGEYRVFTIDRNFRPENLDAKHSMEFHQLDGVIVGRDVNFKHLLYFF
KELAAALGIKEVWFKPGYFPFTEPSVEGYIKHPRLGWVEVFPGGVFRPEVMNILGAPGVRAVAWGIGVDRLAMTVLGLND
IRLLFTRDLDVLENIKYNGLPFFKSRTTGKEVRVVEYPY

Specific function: Unknown

COG id: COG0016

COG function: function code J; Phenylalanyl-tRNA synthetase alpha subunit

Gene ontology:

Cell location: Cytoplasm [H]

Metaboloic importance: Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the class-II aminoacyl-tRNA synthetase family. Phe-tRNA synthetase alpha chain type 2 subfamily [H]

Homologues:

Organism=Homo sapiens, GI4758340, Length=260, Percent_Identity=39.6153846153846, Blast_Score=194, Evalue=2e-49,
Organism=Escherichia coli, GI1788007, Length=275, Percent_Identity=30.1818181818182, Blast_Score=109, Evalue=4e-25,
Organism=Caenorhabditis elegans, GI32563657, Length=267, Percent_Identity=42.3220973782771, Blast_Score=209, Evalue=3e-54,
Organism=Caenorhabditis elegans, GI17508957, Length=267, Percent_Identity=42.3220973782771, Blast_Score=208, Evalue=5e-54,
Organism=Saccharomyces cerevisiae, GI6321087, Length=509, Percent_Identity=29.2730844793713, Blast_Score=192, Evalue=1e-49,
Organism=Drosophila melanogaster, GI18858079, Length=337, Percent_Identity=36.7952522255193, Blast_Score=187, Evalue=2e-47,

Paralogues:

None

Copy number: 2,000 Molecules/Cell In: Glucose minimal media [C]

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR006195
- InterPro:   IPR004529
- InterPro:   IPR022917
- InterPro:   IPR002319 [H]

Pfam domain/function: PF01409 tRNA-synt_2d [H]

EC number: =6.1.1.20 [H]

Molecular weight: Translated: 60182; Mature: 60051

Theoretical pI: Translated: 7.15; Mature: 7.15

Prosite motif: PS50862 AA_TRNA_LIGASE_II

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.0 %Cys     (Translated Protein)
2.1 %Met     (Translated Protein)
3.1 %Cys+Met (Translated Protein)
1.0 %Cys     (Mature Protein)
1.9 %Met     (Mature Protein)
2.9 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MGGEECLSRPVFLSPRQYRIVSILVEKKAIDINTLAQLIEGRPEDLMRDLAELEGRKLIR
CCCHHHHCCCEEECCCCEEEEEEEHHHHCCCHHHHHHHHCCCHHHHHHHHHHHCHHHHHH
ILKQAVKIPVLTSEAYFYLEKGMPEEQVYRVLGKCVNKPLNEFIQCIREHTGIPEEIVKI
HHHHHHCCCEEECCCEEEECCCCCHHHHHHHHHHHHCHHHHHHHHHHHHHCCCHHHHHHH
GLQYHLKSKCLVVLNGIVAKGEEEKCIELMKSAEEVKRKLELIRDKGEMPSDTELLRRRH
HHHHHHCCCHHHEEHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHH
LIELRDRTSITVLPMPELLDLYRNGLVREKEVLTIVKPALTPTLDQYIIKEFDLSIEPPA
HHHHCCCCCEEEECCHHHHHHHHCCCCCCHHHHHHHHHHCCHHHHHHHHHHHCCCCCCCC
IPLARKHPFMEFIDDLRDILTSMGFEEVKGPHVEAEFWNFDVLFQAQDHPAREIHDTFFL
CCCCCCCCHHHHHHHHHHHHHHCCHHHHCCCCCEEEEECEEEEEECCCCCHHHHHHHHEE
KTDLRAKIPAWLLERAGRIHEEGWRYKWSPERSLRLVLRSQTTAVSARAIYERGEGEYRV
ECCCHHHHHHHHHHHCCCCHHCCCCEECCCCHHHHHHHHHHHHHHHHHHHHHCCCCCEEE
FTIDRNFRPENLDAKHSMEFHQLDGVIVGRDVNFKHLLYFFKELAAALGIKEVWFKPGYF
EEEECCCCCCCCCHHHCCHHHHHCCEEEECCCCHHHHHHHHHHHHHHHCHHHHHCCCCCC
PFTEPSVEGYIKHPRLGWVEVFPGGVFRPEVMNILGAPGVRAVAWGIGVDRLAMTVLGLN
CCCCCCCCCEECCCCCCEEEECCCCCCCHHHHHHHCCCCHHHHHHHCCHHHHHHHHHCCC
DIRLLFTRDLDVLENIKYNGLPFFKSRTTGKEVRVVEYPY
CEEEEEECCHHHHHCCCCCCCCCCCCCCCCCCEEEEECCC
>Mature Secondary Structure 
GGEECLSRPVFLSPRQYRIVSILVEKKAIDINTLAQLIEGRPEDLMRDLAELEGRKLIR
CCHHHHCCCEEECCCCEEEEEEEHHHHCCCHHHHHHHHCCCHHHHHHHHHHHCHHHHHH
ILKQAVKIPVLTSEAYFYLEKGMPEEQVYRVLGKCVNKPLNEFIQCIREHTGIPEEIVKI
HHHHHHCCCEEECCCEEEECCCCCHHHHHHHHHHHHCHHHHHHHHHHHHHCCCHHHHHHH
GLQYHLKSKCLVVLNGIVAKGEEEKCIELMKSAEEVKRKLELIRDKGEMPSDTELLRRRH
HHHHHHCCCHHHEEHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHH
LIELRDRTSITVLPMPELLDLYRNGLVREKEVLTIVKPALTPTLDQYIIKEFDLSIEPPA
HHHHCCCCCEEEECCHHHHHHHHCCCCCCHHHHHHHHHHCCHHHHHHHHHHHCCCCCCCC
IPLARKHPFMEFIDDLRDILTSMGFEEVKGPHVEAEFWNFDVLFQAQDHPAREIHDTFFL
CCCCCCCCHHHHHHHHHHHHHHCCHHHHCCCCCEEEEECEEEEEECCCCCHHHHHHHHEE
KTDLRAKIPAWLLERAGRIHEEGWRYKWSPERSLRLVLRSQTTAVSARAIYERGEGEYRV
ECCCHHHHHHHHHHHCCCCHHCCCCEECCCCHHHHHHHHHHHHHHHHHHHHHCCCCCEEE
FTIDRNFRPENLDAKHSMEFHQLDGVIVGRDVNFKHLLYFFKELAAALGIKEVWFKPGYF
EEEECCCCCCCCCHHHCCHHHHHCCEEEECCCCHHHHHHHHHHHHHHHCHHHHHCCCCCC
PFTEPSVEGYIKHPRLGWVEVFPGGVFRPEVMNILGAPGVRAVAWGIGVDRLAMTVLGLN
CCCCCCCCCEECCCCCCEEEECCCCCCCHHHHHHHCCCCHHHHHHHCCHHHHHHHHHCCC
DIRLLFTRDLDVLENIKYNGLPFFKSRTTGKEVRVVEYPY
CEEEEEECCHHHHHCCCCCCCCCCCCCCCCCCEEEEECCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA