| Definition | Streptococcus pneumoniae D39, complete genome. |
|---|---|
| Accession | NC_008533 |
| Length | 2,046,115 |
Click here to switch to the map view.
The map label for this gene is alaS [H]
Identifier: 116515613
GI number: 116515613
Start: 1246418
End: 1249036
Strand: Reverse
Name: alaS [H]
Synonym: SPD_1216
Alternate gene names: 116515613
Gene position: 1249036-1246418 (Counterclockwise)
Preceding gene: 116515414
Following gene: 116515435
Centisome position: 61.04
GC content: 44.6
Gene sequence:
>2619_bases ATGAAACAACTATCTAGTGCACAAGTACGCCAAATGTGGCTTGATTTCTGGGCGACCAAAGGTCACTCAGTAGAACCATC AGTAAGTTTGGTTCCTGTAAATGACCCAACTCTTTTGTGGATCAACTCTGGGGTAGCAACCCTTAAGAAATACTTTGACG GGACCATTATCCCTGAAAATCCACGTATTACCAATGCCCAAAAGGCTATCCGTACCAACGACATCGAAAACGTAGGGAAG ACTGCGCGTCACCATACCATGTTTGAAATGCTGGGGAACTTCTCTATCGGGGATTACTTCCGTGACGAAGCTATCACTTG GGCTTATGAGCTTTTGACAAGCCCTGAATGGTTTGATTTCCCTGCTGAAAAACTTTACATGACCTACTATCCAGACGATA AAGATTCTTACAACCGCTGGATTGAAGTGGGAGTGGATCCAAGTCACTTGATTCCAATTGAGGACAACTTCTGGGAAATC GGTGCGGGACCTTCTGGACCAGATACAGAAATCTTCTTTGACCGTGGGGAAGCCTTTGACCCAGAAAATATCGGTCTTCG CCTGCTTGCAGAAGATATTGAAAACGACCGTTATATTGAAATCTGGAACATCGTTTTGTCACAATTTAACGCAGACCCTG CTGTTCCTCGTAGCGAATACAAGGAATTGCCACATAAGAACATTGATACGGGCGCTGGTTTGGAGCGTTTGGTGGCCGTT ATCCAAGGGGCTAAGACCAACTTTGAAACGGACCTCTTCATGCCGATTATCCGTGAAGTCGAGAAATTGTCTGGTAAGGT TTATGACCAAGATGGCGACAACATGAGCTTCAAGGTTATCGCAGACCACATTCGTTCTCTTTCATTTGCTATCGGTGATG GTGCCCTTCCAGGAAATGAAGGTCGTGGTTATGTTCTTCGTCGTCTTCTCCGTCGTGCTTCTATGCATGGTCAAAAATTG GGTATCAACGAGCCTTTCCTTTACAAATTGGTTCCAACTGTTGGAAAAATCATGGAAAGCTACTACCCAGAAGTGCTTGA GAAACGTGACTTTATTGAGAAAATCGTTAAGAGCGAAGAAGAATCATTTGCCCGTACCCTTCACTCAGGTCAACACTTTG CCCAAGGCATTGTGGCAGACTTGAAAGAAAAAGGTCAATCTGTCATTGCTGGTCAAGATGTCTTTAAACTCTATGATACT TATGGGTTCCCAGTTGAATTGACTGAAGAAATCGCTGAAGAAGCTGGTATGACTGTAGACCGTGAAGGTTTTGAAGCAGC CATGAAAGAACAGCAAGAACGCGCGCGTGCGTCAGCTGTCAAGGGTGGCTCAATGGGTATGCAAAATGAAACTCTTCAAA ACATCACTGTAGAAAGTGTCTTCAACTACAATACTAGCCAATTGTCTTCTAAATTGGTAGCTATCGTTGCTGACAATGCA GAAGTAGGAGCTGTTTCAGAAGGAACTGCCTCTCTTATCTTTGCGGAAACGTCATTTTATGCTGAAATGGGTGGACAGGT AGCTGACTACGGACAAATCTTGGATGAGTCAGGTAAGATTGTGGCTACTGTGACCAATGTTCAGAAAGCCCCAAATGGTC AAGCCCTTCATACAGTTGAAGTCCTTGCACCGCTTGCCTTGAACCAAGAATATACCTTGGCAATTGATAGCAATCGCCGT CACCGTGTCATGAAAAACCACACTGCGACTCATTTGCTTCACGCTGCCCTTCACAATATCCTTGGAAACCACGCAACACA GGCAGGATCTCTTAACGAAGTTGAATTCCTTCGCTTTGACTTTACCCACTTCCAAGCAGTAACTGCTGAGGAACTTCGTG CGATTGAACAGCAAGTTAACGAGAAAATTTGGGAAGCACTTGAAGTGAAGACAGTTGAAACGGATATTGACACTGCTAAA GAAATGGGAGCTATGGCCCTCTTTGGTGAGAAATACGGCAAGGAAGTTCGTGTCGTGACTATCGGTGACTACTCTATTGA ACTTTGTGGTGGTACTCATGTTGACAACACTTCTGAGATTGGTCTCTTCAAAATTGTCAAAGAAGAAGGAATCGGTTCAG GAACTCGCCGTATCTTGGCAGTGACTGGTAAGGAAGCCTTTGAAGCCTATCGTGAACAAGAGGATGCTCTTAAAGCTATC GCAGCAACCTTGAAAGCACCTCAAGTCAAGGAAGTACCTCACAAGGTAGAAGGACTTCAAGAACAACTTCGTCAACTTCA AAAAGAAAATGCTGAGTTGAAAGAAAAAGCCGCAGCTGCAGCCGCAGGCGATATCTTCAAAGATGTTAAGGAAGTCAACG GTCATCGTTACATTGCTAGTCAAGTGTCTGTATCCGATGCCGGTGCCCTTCGTACTTTTGCAGATAACTGGAAACAAAAA GACTACTCTGATCTTCTTGTCCTAGTTGCCGCTATCGGTGACAAAGTCAATGTCCTTGTAGCAAGCAAGACAAAAGACCT TCATGCAGGAAACCTTGTCAAAGAATTAGCACCAATCATCGATGGACGTGGTGGTGGTAAACCAGATATGGCCATGGCAG GAGGAAGCAACCAACCTAAGATCCAAGAATTGTTGGATGCAGTAGCAGGTAAATTGTAA
Upstream 100 bases:
>100_bases AGACGCTTATGCAGACCTAGTCATTTCCCTCTGTGTCGCGATTGACTATGTGGAAATGCTGGAAAGCCAATCACATTAAA CAAGTGAATAAGGAGACAAT
Downstream 100 bases:
>100_bases TCAAGTAAAGATCTATCCATTTGGGTAGGTCTTTTTGTGAATACAAAAAAGCCAAATCCGCTTGGACCTAGCTTGGTTAT TATGAGCTATTAGATGGTAT
Product: alanyl-tRNA synthetase
Products: NA
Alternate protein names: Alanine--tRNA ligase; AlaRS [H]
Number of amino acids: Translated: 872; Mature: 872
Protein sequence:
>872_residues MKQLSSAQVRQMWLDFWATKGHSVEPSVSLVPVNDPTLLWINSGVATLKKYFDGTIIPENPRITNAQKAIRTNDIENVGK TARHHTMFEMLGNFSIGDYFRDEAITWAYELLTSPEWFDFPAEKLYMTYYPDDKDSYNRWIEVGVDPSHLIPIEDNFWEI GAGPSGPDTEIFFDRGEAFDPENIGLRLLAEDIENDRYIEIWNIVLSQFNADPAVPRSEYKELPHKNIDTGAGLERLVAV IQGAKTNFETDLFMPIIREVEKLSGKVYDQDGDNMSFKVIADHIRSLSFAIGDGALPGNEGRGYVLRRLLRRASMHGQKL GINEPFLYKLVPTVGKIMESYYPEVLEKRDFIEKIVKSEEESFARTLHSGQHFAQGIVADLKEKGQSVIAGQDVFKLYDT YGFPVELTEEIAEEAGMTVDREGFEAAMKEQQERARASAVKGGSMGMQNETLQNITVESVFNYNTSQLSSKLVAIVADNA EVGAVSEGTASLIFAETSFYAEMGGQVADYGQILDESGKIVATVTNVQKAPNGQALHTVEVLAPLALNQEYTLAIDSNRR HRVMKNHTATHLLHAALHNILGNHATQAGSLNEVEFLRFDFTHFQAVTAEELRAIEQQVNEKIWEALEVKTVETDIDTAK EMGAMALFGEKYGKEVRVVTIGDYSIELCGGTHVDNTSEIGLFKIVKEEGIGSGTRRILAVTGKEAFEAYREQEDALKAI AATLKAPQVKEVPHKVEGLQEQLRQLQKENAELKEKAAAAAAGDIFKDVKEVNGHRYIASQVSVSDAGALRTFADNWKQK DYSDLLVLVAAIGDKVNVLVASKTKDLHAGNLVKELAPIIDGRGGGKPDMAMAGGSNQPKIQELLDAVAGKL
Sequences:
>Translated_872_residues MKQLSSAQVRQMWLDFWATKGHSVEPSVSLVPVNDPTLLWINSGVATLKKYFDGTIIPENPRITNAQKAIRTNDIENVGK TARHHTMFEMLGNFSIGDYFRDEAITWAYELLTSPEWFDFPAEKLYMTYYPDDKDSYNRWIEVGVDPSHLIPIEDNFWEI GAGPSGPDTEIFFDRGEAFDPENIGLRLLAEDIENDRYIEIWNIVLSQFNADPAVPRSEYKELPHKNIDTGAGLERLVAV IQGAKTNFETDLFMPIIREVEKLSGKVYDQDGDNMSFKVIADHIRSLSFAIGDGALPGNEGRGYVLRRLLRRASMHGQKL GINEPFLYKLVPTVGKIMESYYPEVLEKRDFIEKIVKSEEESFARTLHSGQHFAQGIVADLKEKGQSVIAGQDVFKLYDT YGFPVELTEEIAEEAGMTVDREGFEAAMKEQQERARASAVKGGSMGMQNETLQNITVESVFNYNTSQLSSKLVAIVADNA EVGAVSEGTASLIFAETSFYAEMGGQVADYGQILDESGKIVATVTNVQKAPNGQALHTVEVLAPLALNQEYTLAIDSNRR HRVMKNHTATHLLHAALHNILGNHATQAGSLNEVEFLRFDFTHFQAVTAEELRAIEQQVNEKIWEALEVKTVETDIDTAK EMGAMALFGEKYGKEVRVVTIGDYSIELCGGTHVDNTSEIGLFKIVKEEGIGSGTRRILAVTGKEAFEAYREQEDALKAI AATLKAPQVKEVPHKVEGLQEQLRQLQKENAELKEKAAAAAAGDIFKDVKEVNGHRYIASQVSVSDAGALRTFADNWKQK DYSDLLVLVAAIGDKVNVLVASKTKDLHAGNLVKELAPIIDGRGGGKPDMAMAGGSNQPKIQELLDAVAGKL >Mature_872_residues MKQLSSAQVRQMWLDFWATKGHSVEPSVSLVPVNDPTLLWINSGVATLKKYFDGTIIPENPRITNAQKAIRTNDIENVGK TARHHTMFEMLGNFSIGDYFRDEAITWAYELLTSPEWFDFPAEKLYMTYYPDDKDSYNRWIEVGVDPSHLIPIEDNFWEI GAGPSGPDTEIFFDRGEAFDPENIGLRLLAEDIENDRYIEIWNIVLSQFNADPAVPRSEYKELPHKNIDTGAGLERLVAV IQGAKTNFETDLFMPIIREVEKLSGKVYDQDGDNMSFKVIADHIRSLSFAIGDGALPGNEGRGYVLRRLLRRASMHGQKL GINEPFLYKLVPTVGKIMESYYPEVLEKRDFIEKIVKSEEESFARTLHSGQHFAQGIVADLKEKGQSVIAGQDVFKLYDT YGFPVELTEEIAEEAGMTVDREGFEAAMKEQQERARASAVKGGSMGMQNETLQNITVESVFNYNTSQLSSKLVAIVADNA EVGAVSEGTASLIFAETSFYAEMGGQVADYGQILDESGKIVATVTNVQKAPNGQALHTVEVLAPLALNQEYTLAIDSNRR HRVMKNHTATHLLHAALHNILGNHATQAGSLNEVEFLRFDFTHFQAVTAEELRAIEQQVNEKIWEALEVKTVETDIDTAK EMGAMALFGEKYGKEVRVVTIGDYSIELCGGTHVDNTSEIGLFKIVKEEGIGSGTRRILAVTGKEAFEAYREQEDALKAI AATLKAPQVKEVPHKVEGLQEQLRQLQKENAELKEKAAAAAAGDIFKDVKEVNGHRYIASQVSVSDAGALRTFADNWKQK DYSDLLVLVAAIGDKVNVLVASKTKDLHAGNLVKELAPIIDGRGGGKPDMAMAGGSNQPKIQELLDAVAGKL
Specific function: Catalyzes the attachment of alanine to tRNA(Ala) in a two-step reaction:alanine is first activated by ATP to form Ala- AMP and then transferred to the acceptor end of tRNA(Ala). Also edits incorrectly charged Ser-tRNA(Ala) and Gly-tRNA(Ala) via its editin
COG id: COG0013
COG function: function code J; Alanyl-tRNA synthetase
Gene ontology:
Cell location: Cytoplasm [H]
Metaboloic importance: Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the class-II aminoacyl-tRNA synthetase family [H]
Homologues:
Organism=Homo sapiens, GI109148542, Length=967, Percent_Identity=34.6432264736298, Blast_Score=471, Evalue=1e-132, Organism=Homo sapiens, GI38569417, Length=768, Percent_Identity=32.8125, Blast_Score=347, Evalue=2e-95, Organism=Homo sapiens, GI217416402, Length=266, Percent_Identity=28.5714285714286, Blast_Score=79, Evalue=2e-14, Organism=Homo sapiens, GI13376886, Length=266, Percent_Identity=28.5714285714286, Blast_Score=78, Evalue=4e-14, Organism=Escherichia coli, GI1789048, Length=896, Percent_Identity=42.2991071428571, Blast_Score=655, Evalue=0.0, Organism=Caenorhabditis elegans, GI17506981, Length=977, Percent_Identity=32.8556806550665, Blast_Score=441, Evalue=1e-123, Organism=Caenorhabditis elegans, GI17536681, Length=767, Percent_Identity=31.6818774445893, Blast_Score=357, Evalue=2e-98, Organism=Saccharomyces cerevisiae, GI6324911, Length=807, Percent_Identity=38.1660470879802, Blast_Score=495, Evalue=1e-140, Organism=Drosophila melanogaster, GI24582809, Length=974, Percent_Identity=33.4702258726899, Blast_Score=469, Evalue=1e-132, Organism=Drosophila melanogaster, GI45552267, Length=974, Percent_Identity=33.4702258726899, Blast_Score=469, Evalue=1e-132, Organism=Drosophila melanogaster, GI24658214, Length=859, Percent_Identity=28.5215366705471, Blast_Score=288, Evalue=2e-77, Organism=Drosophila melanogaster, GI18543305, Length=389, Percent_Identity=25.9640102827763, Blast_Score=74, Evalue=3e-13,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR002318 - InterPro: IPR018162 - InterPro: IPR018165 - InterPro: IPR018164 - InterPro: IPR023033 - InterPro: IPR003156 - InterPro: IPR018163 - InterPro: IPR012947 [H]
Pfam domain/function: PF02272 DHHA1; PF01411 tRNA-synt_2c; PF07973 tRNA_SAD [H]
EC number: =6.1.1.7 [H]
Molecular weight: Translated: 96526; Mature: 96526
Theoretical pI: Translated: 4.79; Mature: 4.79
Prosite motif: PS50860 AA_TRNA_LIGASE_II_ALA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.1 %Cys (Translated Protein) 2.2 %Met (Translated Protein) 2.3 %Cys+Met (Translated Protein) 0.1 %Cys (Mature Protein) 2.2 %Met (Mature Protein) 2.3 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MKQLSSAQVRQMWLDFWATKGHSVEPSVSLVPVNDPTLLWINSGVATLKKYFDGTIIPEN CCCCHHHHHHHHHHHHHHCCCCCCCCCEEEEECCCCEEEEECCCHHHHHHHHCCCCCCCC PRITNAQKAIRTNDIENVGKTARHHTMFEMLGNFSIGDYFRDEAITWAYELLTSPEWFDF CCCCCHHHHHHHCCHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHCCCCCCCC PAEKLYMTYYPDDKDSYNRWIEVGVDPSHLIPIEDNFWEIGAGPSGPDTEIFFDRGEAFD CCHHEEEEECCCCCCCCCCEEEECCCCCEEEECCCCCEEECCCCCCCCCCEEEECCCCCC PENIGLRLLAEDIENDRYIEIWNIVLSQFNADPAVPRSEYKELPHKNIDTGAGLERLVAV CCCCCCEEEEHHCCCCCEEHHHHHHHHHCCCCCCCCHHHHHHCCCCCCCCCCCHHHHHHH IQGAKTNFETDLFMPIIREVEKLSGKVYDQDGDNMSFKVIADHIRSLSFAIGDGALPGNE HHCCCCCCCHHHHHHHHHHHHHHCCEEECCCCCCCCHHHHHHHHHHHHHEECCCCCCCCC GRGYVLRRLLRRASMHGQKLGINEPFLYKLVPTVGKIMESYYPEVLEKRDFIEKIVKSEE CCHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCHH ESFARTLHSGQHFAQGIVADLKEKGQSVIAGQDVFKLYDTYGFPVELTEEIAEEAGMTVD HHHHHHHHCCHHHHHHHHHHHHHCCCCEECHHHHHHHHHHCCCCHHHHHHHHHHHCCEEC REGFEAAMKEQQERARASAVKGGSMGMQNETLQNITVESVFNYNTSQLSSKLVAIVADNA CHHHHHHHHHHHHHHHHHHCCCCCCCCCCHHHHHCCHHHHHCCCHHHHHCCEEEEEECCC EVGAVSEGTASLIFAETSFYAEMGGQVADYGQILDESGKIVATVTNVQKAPNGQALHTVE CCCCCCCCCEEEEEEEHHHHHHHCCCHHHHHHHHCCCCCEEEEEECHHCCCCCCCEEHHH VLAPLALNQEYTLAIDSNRRHRVMKNHTATHLLHAALHNILGNHATQAGSLNEVEFLRFD HHHHHHCCCCEEEEECCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCEEEEEEE FTHFQAVTAEELRAIEQQVNEKIWEALEVKTVETDIDTAKEMGAMALFGEKYGKEVRVVT HHHHHHHHHHHHHHHHHHHHHHHHHHHHHEEEHHHHHHHHHHHHHHHHHHHHCCEEEEEE IGDYSIELCGGTHVDNTSEIGLFKIVKEEGIGSGTRRILAVTGKEAFEAYREQEDALKAI ECCEEEEECCCCCCCCCCCCHHHEEEHHCCCCCCCCEEEEEECHHHHHHHHHHHHHHHHH AATLKAPQVKEVPHKVEGLQEQLRQLQKENAELKEKAAAAAAGDIFKDVKEVNGHRYIAS HHHHCCCCHHHHHHHHHHHHHHHHHHHHHCHHHHHHHHHHHHHHHHHHHHHCCCCEEEEE QVSVSDAGALRTFADNWKQKDYSDLLVLVAAIGDKVNVLVASKTKDLHAGNLVKELAPII CCCCCCCHHHHHHHHHHCCCCHHHHHHHHHHHCCCEEEEEEECCCCCHHHHHHHHHHHHH DGRGGGKPDMAMAGGSNQPKIQELLDAVAGKL CCCCCCCCCCEECCCCCCCHHHHHHHHHHCCC >Mature Secondary Structure MKQLSSAQVRQMWLDFWATKGHSVEPSVSLVPVNDPTLLWINSGVATLKKYFDGTIIPEN CCCCHHHHHHHHHHHHHHCCCCCCCCCEEEEECCCCEEEEECCCHHHHHHHHCCCCCCCC PRITNAQKAIRTNDIENVGKTARHHTMFEMLGNFSIGDYFRDEAITWAYELLTSPEWFDF CCCCCHHHHHHHCCHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHCCCCCCCC PAEKLYMTYYPDDKDSYNRWIEVGVDPSHLIPIEDNFWEIGAGPSGPDTEIFFDRGEAFD CCHHEEEEECCCCCCCCCCEEEECCCCCEEEECCCCCEEECCCCCCCCCCEEEECCCCCC PENIGLRLLAEDIENDRYIEIWNIVLSQFNADPAVPRSEYKELPHKNIDTGAGLERLVAV CCCCCCEEEEHHCCCCCEEHHHHHHHHHCCCCCCCCHHHHHHCCCCCCCCCCCHHHHHHH IQGAKTNFETDLFMPIIREVEKLSGKVYDQDGDNMSFKVIADHIRSLSFAIGDGALPGNE HHCCCCCCCHHHHHHHHHHHHHHCCEEECCCCCCCCHHHHHHHHHHHHHEECCCCCCCCC GRGYVLRRLLRRASMHGQKLGINEPFLYKLVPTVGKIMESYYPEVLEKRDFIEKIVKSEE CCHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCHH ESFARTLHSGQHFAQGIVADLKEKGQSVIAGQDVFKLYDTYGFPVELTEEIAEEAGMTVD HHHHHHHHCCHHHHHHHHHHHHHCCCCEECHHHHHHHHHHCCCCHHHHHHHHHHHCCEEC REGFEAAMKEQQERARASAVKGGSMGMQNETLQNITVESVFNYNTSQLSSKLVAIVADNA CHHHHHHHHHHHHHHHHHHCCCCCCCCCCHHHHHCCHHHHHCCCHHHHHCCEEEEEECCC EVGAVSEGTASLIFAETSFYAEMGGQVADYGQILDESGKIVATVTNVQKAPNGQALHTVE CCCCCCCCCEEEEEEEHHHHHHHCCCHHHHHHHHCCCCCEEEEEECHHCCCCCCCEEHHH VLAPLALNQEYTLAIDSNRRHRVMKNHTATHLLHAALHNILGNHATQAGSLNEVEFLRFD HHHHHHCCCCEEEEECCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCEEEEEEE FTHFQAVTAEELRAIEQQVNEKIWEALEVKTVETDIDTAKEMGAMALFGEKYGKEVRVVT HHHHHHHHHHHHHHHHHHHHHHHHHHHHHEEEHHHHHHHHHHHHHHHHHHHHCCEEEEEE IGDYSIELCGGTHVDNTSEIGLFKIVKEEGIGSGTRRILAVTGKEAFEAYREQEDALKAI ECCEEEEECCCCCCCCCCCCHHHEEEHHCCCCCCCCEEEEEECHHHHHHHHHHHHHHHHH AATLKAPQVKEVPHKVEGLQEQLRQLQKENAELKEKAAAAAAGDIFKDVKEVNGHRYIAS HHHHCCCCHHHHHHHHHHHHHHHHHHHHHCHHHHHHHHHHHHHHHHHHHHHCCCCEEEEE QVSVSDAGALRTFADNWKQKDYSDLLVLVAAIGDKVNVLVASKTKDLHAGNLVKELAPII CCCCCCCHHHHHHHHHHCCCCHHHHHHHHHHHCCCEEEEEEECCCCCHHHHHHHHHHHHH DGRGGGKPDMAMAGGSNQPKIQELLDAVAGKL CCCCCCCCCCEECCCCCCCHHHHHHHHHHCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: NA