Definition Mycobacterium bovis BCG str. Pasteur 1173P2, complete genome.
Accession NC_008769
Length 4,374,522

Click here to switch to the map view.

The map label for this gene is glyS

Identifier: 121638236

GI number: 121638236

Start: 2604695

End: 2606086

Strand: Reverse

Name: glyS

Synonym: BCG_2371c

Alternate gene names: 121638236

Gene position: 2606086-2604695 (Counterclockwise)

Preceding gene: 121638239

Following gene: 121638235

Centisome position: 59.57

GC content: 61.21

Gene sequence:

>1392_bases
GTGCACCACCCCGTGGCGCCCGTCATCGACACCGTGGTCAACCTAGCCAAACGGCGAGGCTTCGTCTATCCGTCGGGCGA
GATCTACGGCGGCACAAAGTCGGCGTGGGACTATGGTCCGCTAGGGGTTGAGCTCAAAGAGAACATCAAGCGCCAGTGGT
GGCGATCGGTGGTGACTGGCCGCGACGACGTTGTCGGAATCGATTCGTCGATCATCCTGCCGCGTGAGGTGTGGGTGGCT
TCCGGTCACGTCGATGTCTTTCATGACCCGCTGGTCGAGTCGCTGATCACACATAAGCGCTACCGGGCCGACCATCTCAT
CGAGGCCTACGAAGCCAAACACGGGCATCCGCCGCCTAACGGGTTGGCCGACATTCGCGACCCGGAAACCGGCGAACCCG
GCCAGTGGACGCAGCCACGCGAGTTCAACATGATGCTCAAGACCTACCTCGGACCCATCGAGACCGAGGAGGGGCTGCAC
TATCTGCGCCCGGAAACCGCGCAGGGCATCTTCGTGAACTTTGCCAACGTGGTGACAACTGCTCGTAAGAAGCCGCCATT
CGGTATCGGACAGATCGGCAAGAGCTTTCGCAACGAGATCACTCCGGGCAACTTCATCTTCCGGACCCGCGAGTTCGAGC
AGATGGAGATGGAGTTCTTCGTCGAGCCGGCGACTGCCAAGGAATGGCATCAGTACTGGATCGACAACCGGCTGCAGTGG
TATATCGACCTGGGTATTCGTCGGGAGAACCTGCGGTTGTGGGAGCACCCCAAAGACAAGTTGTCACATTACTCCGACCG
CACCGTCGACATCGAGTACAAGTTCGGCTTCATGGGCAATCCATGGGGTGAACTGGAAGGTGTGGCCAACCGAACCGATT
TTGACCTATCGACGCATGCGCGGCATTCCGGCGTCGACCTGTCTTTCTACGACCAGATCAACGATGTTCGGTACACGCCG
TACGTCATCGAGCCGGCAGCTGGCTTGACCCGGTCATTCATGGCGTTTTTGATCGACGCGTACACCGAGGACGAGGCCCC
GAATACCAAGGGTGGGATGGATAAGCGCACGGTGCTGCGATTGGACCCGCGGCTGGCGCCGGTCAAGGCGGCGGTGTTGC
CGCTGTCCCGGCACGCGGACCTGAGCCCGAAGGCCCGGGACCTGGGCGCCGAATTACGGAAATGCTGGAACATCGATTTC
GATGATGCCGGCGCTATCGGGCGGCGTTACCGGCGCCAGGACGAGGTCGGTACCCCGTTCTGTGTGACGGTTGACTTCGA
CTCGCTGCAGGACAATGCCGTCACCGTGCGGGAGCGTGACGCCATGACGCAGGACCGGGTTGCGATGAGCAGCGTGGCCG
ACTATCTCGCGGTGCGGCTCAAGGGCAGCTAG

Upstream 100 bases:

>100_bases
TCAAAGGCAATAGGAGACCCAGGTCCCGATCGCTACCATGACTGATGTTTTGCGCGTAGTCGTGTCGGGCTGCGCGCGTC
TGCCCGATCCCTCGAAGGGA

Downstream 100 bases:

>100_bases
CAGCCCCGGTCCGGGCACGACCCGGTGAGCTGTGGTGGCCGCTGGGTGGGCGGCGCCGTGGTGACGGGTGTCCGCGTGTC
GTTTGGGGTAACGCGCGGGG

Product: glycyl-tRNA synthetase

Products: NA

Alternate protein names: Glycine--tRNA ligase; GlyRS

Number of amino acids: Translated: 463; Mature: 463

Protein sequence:

>463_residues
MHHPVAPVIDTVVNLAKRRGFVYPSGEIYGGTKSAWDYGPLGVELKENIKRQWWRSVVTGRDDVVGIDSSIILPREVWVA
SGHVDVFHDPLVESLITHKRYRADHLIEAYEAKHGHPPPNGLADIRDPETGEPGQWTQPREFNMMLKTYLGPIETEEGLH
YLRPETAQGIFVNFANVVTTARKKPPFGIGQIGKSFRNEITPGNFIFRTREFEQMEMEFFVEPATAKEWHQYWIDNRLQW
YIDLGIRRENLRLWEHPKDKLSHYSDRTVDIEYKFGFMGNPWGELEGVANRTDFDLSTHARHSGVDLSFYDQINDVRYTP
YVIEPAAGLTRSFMAFLIDAYTEDEAPNTKGGMDKRTVLRLDPRLAPVKAAVLPLSRHADLSPKARDLGAELRKCWNIDF
DDAGAIGRRYRRQDEVGTPFCVTVDFDSLQDNAVTVRERDAMTQDRVAMSSVADYLAVRLKGS

Sequences:

>Translated_463_residues
MHHPVAPVIDTVVNLAKRRGFVYPSGEIYGGTKSAWDYGPLGVELKENIKRQWWRSVVTGRDDVVGIDSSIILPREVWVA
SGHVDVFHDPLVESLITHKRYRADHLIEAYEAKHGHPPPNGLADIRDPETGEPGQWTQPREFNMMLKTYLGPIETEEGLH
YLRPETAQGIFVNFANVVTTARKKPPFGIGQIGKSFRNEITPGNFIFRTREFEQMEMEFFVEPATAKEWHQYWIDNRLQW
YIDLGIRRENLRLWEHPKDKLSHYSDRTVDIEYKFGFMGNPWGELEGVANRTDFDLSTHARHSGVDLSFYDQINDVRYTP
YVIEPAAGLTRSFMAFLIDAYTEDEAPNTKGGMDKRTVLRLDPRLAPVKAAVLPLSRHADLSPKARDLGAELRKCWNIDF
DDAGAIGRRYRRQDEVGTPFCVTVDFDSLQDNAVTVRERDAMTQDRVAMSSVADYLAVRLKGS
>Mature_463_residues
MHHPVAPVIDTVVNLAKRRGFVYPSGEIYGGTKSAWDYGPLGVELKENIKRQWWRSVVTGRDDVVGIDSSIILPREVWVA
SGHVDVFHDPLVESLITHKRYRADHLIEAYEAKHGHPPPNGLADIRDPETGEPGQWTQPREFNMMLKTYLGPIETEEGLH
YLRPETAQGIFVNFANVVTTARKKPPFGIGQIGKSFRNEITPGNFIFRTREFEQMEMEFFVEPATAKEWHQYWIDNRLQW
YIDLGIRRENLRLWEHPKDKLSHYSDRTVDIEYKFGFMGNPWGELEGVANRTDFDLSTHARHSGVDLSFYDQINDVRYTP
YVIEPAAGLTRSFMAFLIDAYTEDEAPNTKGGMDKRTVLRLDPRLAPVKAAVLPLSRHADLSPKARDLGAELRKCWNIDF
DDAGAIGRRYRRQDEVGTPFCVTVDFDSLQDNAVTVRERDAMTQDRVAMSSVADYLAVRLKGS

Specific function: Catalyzes the attachment of glycine to tRNA(Gly)

COG id: COG0423

COG function: function code J; Glycyl-tRNA synthetase (class II)

Gene ontology:

Cell location: Cytoplasm

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Belongs to the class-II aminoacyl-tRNA synthetase family

Homologues:

Organism=Homo sapiens, GI116805340, Length=385, Percent_Identity=30.9090909090909, Blast_Score=168, Evalue=1e-41,
Organism=Caenorhabditis elegans, GI32564541, Length=364, Percent_Identity=29.6703296703297, Blast_Score=154, Evalue=1e-37,
Organism=Caenorhabditis elegans, GI17554996, Length=364, Percent_Identity=29.6703296703297, Blast_Score=154, Evalue=1e-37,
Organism=Saccharomyces cerevisiae, GI6325338, Length=387, Percent_Identity=28.4237726098191, Blast_Score=149, Evalue=1e-36,
Organism=Saccharomyces cerevisiae, GI6319597, Length=235, Percent_Identity=31.063829787234, Blast_Score=107, Evalue=3e-24,
Organism=Drosophila melanogaster, GI21357965, Length=363, Percent_Identity=32.7823691460055, Blast_Score=174, Evalue=2e-43,
Organism=Drosophila melanogaster, GI24664462, Length=363, Percent_Identity=32.7823691460055, Blast_Score=174, Evalue=2e-43,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): SYG_MYCBO (P67033)

Other databases:

- EMBL:   BX248342
- RefSeq:   NP_856027.1
- ProteinModelPortal:   P67033
- SMR:   P67033
- EnsemblBacteria:   EBMYCT00000015261
- GeneID:   1094366
- GenomeReviews:   BX248333_GR
- KEGG:   mbo:Mb2378c
- GeneTree:   EBGT00050000016577
- HOGENOM:   HBG319978
- OMA:   GSEWGEL
- ProtClustDB:   PRK04173
- BioCyc:   MBOV233413:MB2378C-MONOMER
- BRENDA:   6.1.1.14
- GO:   GO:0005737
- HAMAP:   MF_00253_B
- InterPro:   IPR002314
- InterPro:   IPR006195
- InterPro:   IPR004154
- InterPro:   IPR022961
- InterPro:   IPR002315
- Gene3D:   G3DSA:3.40.50.800
- PANTHER:   PTHR10745
- PRINTS:   PR01043
- TIGRFAMs:   TIGR00389

Pfam domain/function: PF03129 HGTP_anticodon; PF00587 tRNA-synt_2b; SSF52954 Anticodon_bd

EC number: =6.1.1.14

Molecular weight: Translated: 52938; Mature: 52938

Theoretical pI: Translated: 6.25; Mature: 6.25

Prosite motif: PS50862 AA_TRNA_LIGASE_II; PS00307 LECTIN_LEGUME_BETA

Important sites: BINDING 102-102 BINDING 165-165

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.4 %Cys     (Translated Protein)
2.2 %Met     (Translated Protein)
2.6 %Cys+Met (Translated Protein)
0.4 %Cys     (Mature Protein)
2.2 %Met     (Mature Protein)
2.6 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MHHPVAPVIDTVVNLAKRRGFVYPSGEIYGGTKSAWDYGPLGVELKENIKRQWWRSVVTG
CCCCHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHCC
RDDVVGIDSSIILPREVWVASGHVDVFHDPLVESLITHKRYRADHLIEAYEAKHGHPPPN
CCCEEECCCCEECCHHHEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCC
GLADIRDPETGEPGQWTQPREFNMMLKTYLGPIETEEGLHYLRPETAQGIFVNFANVVTT
CCCCCCCCCCCCCCCCCCCHHHHHHHHHHCCCCCCCCCCCCCCCCCCCEEEEEHHHHHHH
ARKKPPFGIGQIGKSFRNEITPGNFIFRTREFEQMEMEFFVEPATAKEWHQYWIDNRLQW
HCCCCCCCHHHHHHHHHHCCCCCCEEEECCHHHHHCHHHEECCCCHHHHHHHHHCCCEEE
YIDLGIRRENLRLWEHPKDKLSHYSDRTVDIEYKFGFMGNPWGELEGVANRTDFDLSTHA
EEEECEEECCCCCCCCCHHHHHCCCCCEEEEEEEECCCCCCHHHHCCCCCCCCCCCHHCC
RHSGVDLSFYDQINDVRYTPYVIEPAAGLTRSFMAFLIDAYTEDEAPNTKGGMDKRTVLR
CCCCCCEEHHHCCCCCCCCCEEECCCHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCEEEE
LDPRLAPVKAAVLPLSRHADLSPKARDLGAELRKCWNIDFDDAGAIGRRYRRQDEVGTPF
ECCCCCCHHHHHEECCCCCCCCCHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHCCCCCE
CVTVDFDSLQDNAVTVRERDAMTQDRVAMSSVADYLAVRLKGS
EEEEECCCCCCCEEEEEHHHCHHHHHHHHHHHHHHHHEEECCC
>Mature Secondary Structure
MHHPVAPVIDTVVNLAKRRGFVYPSGEIYGGTKSAWDYGPLGVELKENIKRQWWRSVVTG
CCCCHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHCC
RDDVVGIDSSIILPREVWVASGHVDVFHDPLVESLITHKRYRADHLIEAYEAKHGHPPPN
CCCEEECCCCEECCHHHEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCC
GLADIRDPETGEPGQWTQPREFNMMLKTYLGPIETEEGLHYLRPETAQGIFVNFANVVTT
CCCCCCCCCCCCCCCCCCCHHHHHHHHHHCCCCCCCCCCCCCCCCCCCEEEEEHHHHHHH
ARKKPPFGIGQIGKSFRNEITPGNFIFRTREFEQMEMEFFVEPATAKEWHQYWIDNRLQW
HCCCCCCCHHHHHHHHHHCCCCCCEEEECCHHHHHCHHHEECCCCHHHHHHHHHCCCEEE
YIDLGIRRENLRLWEHPKDKLSHYSDRTVDIEYKFGFMGNPWGELEGVANRTDFDLSTHA
EEEECEEECCCCCCCCCHHHHHCCCCCEEEEEEEECCCCCCHHHHCCCCCCCCCCCHHCC
RHSGVDLSFYDQINDVRYTPYVIEPAAGLTRSFMAFLIDAYTEDEAPNTKGGMDKRTVLR
CCCCCCEEHHHCCCCCCCCCEEECCCHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCEEEE
LDPRLAPVKAAVLPLSRHADLSPKARDLGAELRKCWNIDFDDAGAIGRRYRRQDEVGTPF
ECCCCCCHHHHHEECCCCCCCCCHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHCCCCCE
CVTVDFDSLQDNAVTVRERDAMTQDRVAMSSVADYLAVRLKGS
EEEEECCCCCCCEEEEEHHHCHHHHHHHHHHHHHHHHEEECCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 12788972