| Definition | Mycobacterium bovis BCG str. Pasteur 1173P2, complete genome. |
|---|---|
| Accession | NC_008769 |
| Length | 4,374,522 |
Click here to switch to the map view.
The map label for this gene is glyS
Identifier: 121638236
GI number: 121638236
Start: 2604695
End: 2606086
Strand: Reverse
Name: glyS
Synonym: BCG_2371c
Alternate gene names: 121638236
Gene position: 2606086-2604695 (Counterclockwise)
Preceding gene: 121638239
Following gene: 121638235
Centisome position: 59.57
GC content: 61.21
Gene sequence:
>1392_bases GTGCACCACCCCGTGGCGCCCGTCATCGACACCGTGGTCAACCTAGCCAAACGGCGAGGCTTCGTCTATCCGTCGGGCGA GATCTACGGCGGCACAAAGTCGGCGTGGGACTATGGTCCGCTAGGGGTTGAGCTCAAAGAGAACATCAAGCGCCAGTGGT GGCGATCGGTGGTGACTGGCCGCGACGACGTTGTCGGAATCGATTCGTCGATCATCCTGCCGCGTGAGGTGTGGGTGGCT TCCGGTCACGTCGATGTCTTTCATGACCCGCTGGTCGAGTCGCTGATCACACATAAGCGCTACCGGGCCGACCATCTCAT CGAGGCCTACGAAGCCAAACACGGGCATCCGCCGCCTAACGGGTTGGCCGACATTCGCGACCCGGAAACCGGCGAACCCG GCCAGTGGACGCAGCCACGCGAGTTCAACATGATGCTCAAGACCTACCTCGGACCCATCGAGACCGAGGAGGGGCTGCAC TATCTGCGCCCGGAAACCGCGCAGGGCATCTTCGTGAACTTTGCCAACGTGGTGACAACTGCTCGTAAGAAGCCGCCATT CGGTATCGGACAGATCGGCAAGAGCTTTCGCAACGAGATCACTCCGGGCAACTTCATCTTCCGGACCCGCGAGTTCGAGC AGATGGAGATGGAGTTCTTCGTCGAGCCGGCGACTGCCAAGGAATGGCATCAGTACTGGATCGACAACCGGCTGCAGTGG TATATCGACCTGGGTATTCGTCGGGAGAACCTGCGGTTGTGGGAGCACCCCAAAGACAAGTTGTCACATTACTCCGACCG CACCGTCGACATCGAGTACAAGTTCGGCTTCATGGGCAATCCATGGGGTGAACTGGAAGGTGTGGCCAACCGAACCGATT TTGACCTATCGACGCATGCGCGGCATTCCGGCGTCGACCTGTCTTTCTACGACCAGATCAACGATGTTCGGTACACGCCG TACGTCATCGAGCCGGCAGCTGGCTTGACCCGGTCATTCATGGCGTTTTTGATCGACGCGTACACCGAGGACGAGGCCCC GAATACCAAGGGTGGGATGGATAAGCGCACGGTGCTGCGATTGGACCCGCGGCTGGCGCCGGTCAAGGCGGCGGTGTTGC CGCTGTCCCGGCACGCGGACCTGAGCCCGAAGGCCCGGGACCTGGGCGCCGAATTACGGAAATGCTGGAACATCGATTTC GATGATGCCGGCGCTATCGGGCGGCGTTACCGGCGCCAGGACGAGGTCGGTACCCCGTTCTGTGTGACGGTTGACTTCGA CTCGCTGCAGGACAATGCCGTCACCGTGCGGGAGCGTGACGCCATGACGCAGGACCGGGTTGCGATGAGCAGCGTGGCCG ACTATCTCGCGGTGCGGCTCAAGGGCAGCTAG
Upstream 100 bases:
>100_bases TCAAAGGCAATAGGAGACCCAGGTCCCGATCGCTACCATGACTGATGTTTTGCGCGTAGTCGTGTCGGGCTGCGCGCGTC TGCCCGATCCCTCGAAGGGA
Downstream 100 bases:
>100_bases CAGCCCCGGTCCGGGCACGACCCGGTGAGCTGTGGTGGCCGCTGGGTGGGCGGCGCCGTGGTGACGGGTGTCCGCGTGTC GTTTGGGGTAACGCGCGGGG
Product: glycyl-tRNA synthetase
Products: NA
Alternate protein names: Glycine--tRNA ligase; GlyRS
Number of amino acids: Translated: 463; Mature: 463
Protein sequence:
>463_residues MHHPVAPVIDTVVNLAKRRGFVYPSGEIYGGTKSAWDYGPLGVELKENIKRQWWRSVVTGRDDVVGIDSSIILPREVWVA SGHVDVFHDPLVESLITHKRYRADHLIEAYEAKHGHPPPNGLADIRDPETGEPGQWTQPREFNMMLKTYLGPIETEEGLH YLRPETAQGIFVNFANVVTTARKKPPFGIGQIGKSFRNEITPGNFIFRTREFEQMEMEFFVEPATAKEWHQYWIDNRLQW YIDLGIRRENLRLWEHPKDKLSHYSDRTVDIEYKFGFMGNPWGELEGVANRTDFDLSTHARHSGVDLSFYDQINDVRYTP YVIEPAAGLTRSFMAFLIDAYTEDEAPNTKGGMDKRTVLRLDPRLAPVKAAVLPLSRHADLSPKARDLGAELRKCWNIDF DDAGAIGRRYRRQDEVGTPFCVTVDFDSLQDNAVTVRERDAMTQDRVAMSSVADYLAVRLKGS
Sequences:
>Translated_463_residues MHHPVAPVIDTVVNLAKRRGFVYPSGEIYGGTKSAWDYGPLGVELKENIKRQWWRSVVTGRDDVVGIDSSIILPREVWVA SGHVDVFHDPLVESLITHKRYRADHLIEAYEAKHGHPPPNGLADIRDPETGEPGQWTQPREFNMMLKTYLGPIETEEGLH YLRPETAQGIFVNFANVVTTARKKPPFGIGQIGKSFRNEITPGNFIFRTREFEQMEMEFFVEPATAKEWHQYWIDNRLQW YIDLGIRRENLRLWEHPKDKLSHYSDRTVDIEYKFGFMGNPWGELEGVANRTDFDLSTHARHSGVDLSFYDQINDVRYTP YVIEPAAGLTRSFMAFLIDAYTEDEAPNTKGGMDKRTVLRLDPRLAPVKAAVLPLSRHADLSPKARDLGAELRKCWNIDF DDAGAIGRRYRRQDEVGTPFCVTVDFDSLQDNAVTVRERDAMTQDRVAMSSVADYLAVRLKGS >Mature_463_residues MHHPVAPVIDTVVNLAKRRGFVYPSGEIYGGTKSAWDYGPLGVELKENIKRQWWRSVVTGRDDVVGIDSSIILPREVWVA SGHVDVFHDPLVESLITHKRYRADHLIEAYEAKHGHPPPNGLADIRDPETGEPGQWTQPREFNMMLKTYLGPIETEEGLH YLRPETAQGIFVNFANVVTTARKKPPFGIGQIGKSFRNEITPGNFIFRTREFEQMEMEFFVEPATAKEWHQYWIDNRLQW YIDLGIRRENLRLWEHPKDKLSHYSDRTVDIEYKFGFMGNPWGELEGVANRTDFDLSTHARHSGVDLSFYDQINDVRYTP YVIEPAAGLTRSFMAFLIDAYTEDEAPNTKGGMDKRTVLRLDPRLAPVKAAVLPLSRHADLSPKARDLGAELRKCWNIDF DDAGAIGRRYRRQDEVGTPFCVTVDFDSLQDNAVTVRERDAMTQDRVAMSSVADYLAVRLKGS
Specific function: Catalyzes the attachment of glycine to tRNA(Gly)
COG id: COG0423
COG function: function code J; Glycyl-tRNA synthetase (class II)
Gene ontology:
Cell location: Cytoplasm
Metaboloic importance: NA
Operon status: Not Known
Operon components: None
Similarity: Belongs to the class-II aminoacyl-tRNA synthetase family
Homologues:
Organism=Homo sapiens, GI116805340, Length=385, Percent_Identity=30.9090909090909, Blast_Score=168, Evalue=1e-41, Organism=Caenorhabditis elegans, GI32564541, Length=364, Percent_Identity=29.6703296703297, Blast_Score=154, Evalue=1e-37, Organism=Caenorhabditis elegans, GI17554996, Length=364, Percent_Identity=29.6703296703297, Blast_Score=154, Evalue=1e-37, Organism=Saccharomyces cerevisiae, GI6325338, Length=387, Percent_Identity=28.4237726098191, Blast_Score=149, Evalue=1e-36, Organism=Saccharomyces cerevisiae, GI6319597, Length=235, Percent_Identity=31.063829787234, Blast_Score=107, Evalue=3e-24, Organism=Drosophila melanogaster, GI21357965, Length=363, Percent_Identity=32.7823691460055, Blast_Score=174, Evalue=2e-43, Organism=Drosophila melanogaster, GI24664462, Length=363, Percent_Identity=32.7823691460055, Blast_Score=174, Evalue=2e-43,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): SYG_MYCBO (P67033)
Other databases:
- EMBL: BX248342 - RefSeq: NP_856027.1 - ProteinModelPortal: P67033 - SMR: P67033 - EnsemblBacteria: EBMYCT00000015261 - GeneID: 1094366 - GenomeReviews: BX248333_GR - KEGG: mbo:Mb2378c - GeneTree: EBGT00050000016577 - HOGENOM: HBG319978 - OMA: GSEWGEL - ProtClustDB: PRK04173 - BioCyc: MBOV233413:MB2378C-MONOMER - BRENDA: 6.1.1.14 - GO: GO:0005737 - HAMAP: MF_00253_B - InterPro: IPR002314 - InterPro: IPR006195 - InterPro: IPR004154 - InterPro: IPR022961 - InterPro: IPR002315 - Gene3D: G3DSA:3.40.50.800 - PANTHER: PTHR10745 - PRINTS: PR01043 - TIGRFAMs: TIGR00389
Pfam domain/function: PF03129 HGTP_anticodon; PF00587 tRNA-synt_2b; SSF52954 Anticodon_bd
EC number: =6.1.1.14
Molecular weight: Translated: 52938; Mature: 52938
Theoretical pI: Translated: 6.25; Mature: 6.25
Prosite motif: PS50862 AA_TRNA_LIGASE_II; PS00307 LECTIN_LEGUME_BETA
Important sites: BINDING 102-102 BINDING 165-165
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.4 %Cys (Translated Protein) 2.2 %Met (Translated Protein) 2.6 %Cys+Met (Translated Protein) 0.4 %Cys (Mature Protein) 2.2 %Met (Mature Protein) 2.6 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MHHPVAPVIDTVVNLAKRRGFVYPSGEIYGGTKSAWDYGPLGVELKENIKRQWWRSVVTG CCCCHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHCC RDDVVGIDSSIILPREVWVASGHVDVFHDPLVESLITHKRYRADHLIEAYEAKHGHPPPN CCCEEECCCCEECCHHHEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCC GLADIRDPETGEPGQWTQPREFNMMLKTYLGPIETEEGLHYLRPETAQGIFVNFANVVTT CCCCCCCCCCCCCCCCCCCHHHHHHHHHHCCCCCCCCCCCCCCCCCCCEEEEEHHHHHHH ARKKPPFGIGQIGKSFRNEITPGNFIFRTREFEQMEMEFFVEPATAKEWHQYWIDNRLQW HCCCCCCCHHHHHHHHHHCCCCCCEEEECCHHHHHCHHHEECCCCHHHHHHHHHCCCEEE YIDLGIRRENLRLWEHPKDKLSHYSDRTVDIEYKFGFMGNPWGELEGVANRTDFDLSTHA EEEECEEECCCCCCCCCHHHHHCCCCCEEEEEEEECCCCCCHHHHCCCCCCCCCCCHHCC RHSGVDLSFYDQINDVRYTPYVIEPAAGLTRSFMAFLIDAYTEDEAPNTKGGMDKRTVLR CCCCCCEEHHHCCCCCCCCCEEECCCHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCEEEE LDPRLAPVKAAVLPLSRHADLSPKARDLGAELRKCWNIDFDDAGAIGRRYRRQDEVGTPF ECCCCCCHHHHHEECCCCCCCCCHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHCCCCCE CVTVDFDSLQDNAVTVRERDAMTQDRVAMSSVADYLAVRLKGS EEEEECCCCCCCEEEEEHHHCHHHHHHHHHHHHHHHHEEECCC >Mature Secondary Structure MHHPVAPVIDTVVNLAKRRGFVYPSGEIYGGTKSAWDYGPLGVELKENIKRQWWRSVVTG CCCCHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHCC RDDVVGIDSSIILPREVWVASGHVDVFHDPLVESLITHKRYRADHLIEAYEAKHGHPPPN CCCEEECCCCEECCHHHEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCC GLADIRDPETGEPGQWTQPREFNMMLKTYLGPIETEEGLHYLRPETAQGIFVNFANVVTT CCCCCCCCCCCCCCCCCCCHHHHHHHHHHCCCCCCCCCCCCCCCCCCCEEEEEHHHHHHH ARKKPPFGIGQIGKSFRNEITPGNFIFRTREFEQMEMEFFVEPATAKEWHQYWIDNRLQW HCCCCCCCHHHHHHHHHHCCCCCCEEEECCHHHHHCHHHEECCCCHHHHHHHHHCCCEEE YIDLGIRRENLRLWEHPKDKLSHYSDRTVDIEYKFGFMGNPWGELEGVANRTDFDLSTHA EEEECEEECCCCCCCCCHHHHHCCCCCEEEEEEEECCCCCCHHHHCCCCCCCCCCCHHCC RHSGVDLSFYDQINDVRYTPYVIEPAAGLTRSFMAFLIDAYTEDEAPNTKGGMDKRTVLR CCCCCCEEHHHCCCCCCCCCEEECCCHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCEEEE LDPRLAPVKAAVLPLSRHADLSPKARDLGAELRKCWNIDFDDAGAIGRRYRRQDEVGTPF ECCCCCCHHHHHEECCCCCCCCCHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHCCCCCE CVTVDFDSLQDNAVTVRERDAMTQDRVAMSSVADYLAVRLKGS EEEEECCCCCCCEEEEEHHHCHHHHHHHHHHHHHHHHEEECCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 12788972