Definition Mycobacterium bovis BCG str. Pasteur 1173P2, complete genome.
Accession NC_008769
Length 4,374,522

Click here to switch to the map view.

The map label for this gene is glyA

Identifier: 121637024

GI number: 121637024

Start: 1251990

End: 1253270

Strand: Direct

Name: glyA

Synonym: BCG_1153

Alternate gene names: 121637024

Gene position: 1251990-1253270 (Clockwise)

Preceding gene: 121637022

Following gene: 121637025

Centisome position: 28.62

GC content: 67.21

Gene sequence:

>1281_bases
ATGTCTGCCCCGCTCGCTGAGGTTGACCCCGATATCGCCGAGTTGCTGGCCAAGGAGCTTGGTCGGCAACGAGACACCCT
GGAGATGATCGCCTCGGAGAACTTCGCACCGCGCGCTGTGCTGCAGGCCCAGGGCAGTGTGCTGACCAACAAGTACGCCG
AGGGACTGCCCGGGCGGCGCTACTACGGCGGTTGTGAGCACGTCGACGTGGTGGAAAACCTCGCCCGCGACCGAGCCAAG
GCGTTGTTCGGTGCCGAATTCGCCAATGTGCAACCGCATTCGGGCGCTCAGGCCAACGCCGCGGTGCTGCATGCGCTGAT
GTCACCCGGCGAGCGGCTGTTGGGTCTGGACCTGGCCAACGGTGGTCACCTGACCCATGGCATGCGGCTGAACTTCTCCG
GCAAGCTCTACGAGAATGGCTTCTACGGCGTCGACCCGGCGACACATCTGATCGACATGGATGCGGTGCGGGCCACCGCA
CTCGAATTCCGCCCGAAGGTGATCATCGCCGGCTGGTCGGCCTACCCGCGGGTGCTCGACTTCGCGGCGTTCCGGTCGAT
CGCCGACGAGGTCGGGGCCAAGTTGCTCGTGGACATGGCGCATTTCGCGGGTCTGGTCGCCGCGGGGTTGCACCCGTCGC
CGGTGCCGCACGCGGATGTGGTGTCCACCACCGTGCACAAGACGCTCGGCGGCGGCCGCTCCGGCCTGATCGTCGGTAAG
CAGCAGTACGCCAAGGCGATCAACTCGGCGGTGTTTCCCGGGCAGCAGGGCGGTCCGCTCATGCACGTCATTGCCGGCAA
GGCGGTCGCGTTGAAGATCGCCGCCACACCCGAATTTGCCGACCGGCAGCGGCGCACGCTGTCCGGGGCCCGGATCATTG
CCGATCGACTGATGGCTCCCGATGTCGCCAAGGCCGGTGTGTCGGTGGTCAGCGGCGGCACCGACGTCCACCTGGTGCTG
GTCGATCTGCGTGATTCCCCACTGGATGGCCAGGCCGCCGAGGACCTGCTGCACGAGGTCGGCATCACGGTCAACCGCAA
CGCCGTCCCCAATGATCCCCGACCGCCGATGGTGACCTCGGGCCTGCGGATAGGCACGCCCGCGCTGGCGACCCGCGGCT
TCGGCGACACCGAGTTCACCGAGGTCGCCGACATTATTGCGACCGCGCTGGCGACCGGCAGTTCCGTTGATGTGTCGGCG
CTTAAGGATCGGGCGACCCGGCTGGCCAGGGCGTTTCCGCTCTACGACGGGCTCGAGGAGTGGAGTCTGGTCGGCCGCTG
A

Upstream 100 bases:

>100_bases
GGATGGCGTGTGCTGCATTAAGGGTAATCAGCCCGGGAGCGGCTCGCTGGATACACTGGCGCCCGTGACTGCTGCACCTG
ACGCTCGCACTACCGCTGTA

Downstream 100 bases:

>100_bases
CGCGGGCCTGTCGTTGGCGCGCATAAGCGCGAGAGCGCCGATCACCGCGCGACACGGCGGCGCCCGATTTCACGAAATCT
GTGTATGCGAGTTACAGTTA

Product: serine hydroxymethyltransferase

Products: NA

Alternate protein names: SHMT 1; Serine methylase 1

Number of amino acids: Translated: 426; Mature: 425

Protein sequence:

>426_residues
MSAPLAEVDPDIAELLAKELGRQRDTLEMIASENFAPRAVLQAQGSVLTNKYAEGLPGRRYYGGCEHVDVVENLARDRAK
ALFGAEFANVQPHSGAQANAAVLHALMSPGERLLGLDLANGGHLTHGMRLNFSGKLYENGFYGVDPATHLIDMDAVRATA
LEFRPKVIIAGWSAYPRVLDFAAFRSIADEVGAKLLVDMAHFAGLVAAGLHPSPVPHADVVSTTVHKTLGGGRSGLIVGK
QQYAKAINSAVFPGQQGGPLMHVIAGKAVALKIAATPEFADRQRRTLSGARIIADRLMAPDVAKAGVSVVSGGTDVHLVL
VDLRDSPLDGQAAEDLLHEVGITVNRNAVPNDPRPPMVTSGLRIGTPALATRGFGDTEFTEVADIIATALATGSSVDVSA
LKDRATRLARAFPLYDGLEEWSLVGR

Sequences:

>Translated_426_residues
MSAPLAEVDPDIAELLAKELGRQRDTLEMIASENFAPRAVLQAQGSVLTNKYAEGLPGRRYYGGCEHVDVVENLARDRAK
ALFGAEFANVQPHSGAQANAAVLHALMSPGERLLGLDLANGGHLTHGMRLNFSGKLYENGFYGVDPATHLIDMDAVRATA
LEFRPKVIIAGWSAYPRVLDFAAFRSIADEVGAKLLVDMAHFAGLVAAGLHPSPVPHADVVSTTVHKTLGGGRSGLIVGK
QQYAKAINSAVFPGQQGGPLMHVIAGKAVALKIAATPEFADRQRRTLSGARIIADRLMAPDVAKAGVSVVSGGTDVHLVL
VDLRDSPLDGQAAEDLLHEVGITVNRNAVPNDPRPPMVTSGLRIGTPALATRGFGDTEFTEVADIIATALATGSSVDVSA
LKDRATRLARAFPLYDGLEEWSLVGR
>Mature_425_residues
SAPLAEVDPDIAELLAKELGRQRDTLEMIASENFAPRAVLQAQGSVLTNKYAEGLPGRRYYGGCEHVDVVENLARDRAKA
LFGAEFANVQPHSGAQANAAVLHALMSPGERLLGLDLANGGHLTHGMRLNFSGKLYENGFYGVDPATHLIDMDAVRATAL
EFRPKVIIAGWSAYPRVLDFAAFRSIADEVGAKLLVDMAHFAGLVAAGLHPSPVPHADVVSTTVHKTLGGGRSGLIVGKQ
QYAKAINSAVFPGQQGGPLMHVIAGKAVALKIAATPEFADRQRRTLSGARIIADRLMAPDVAKAGVSVVSGGTDVHLVLV
DLRDSPLDGQAAEDLLHEVGITVNRNAVPNDPRPPMVTSGLRIGTPALATRGFGDTEFTEVADIIATALATGSSVDVSAL
KDRATRLARAFPLYDGLEEWSLVGR

Specific function: Interconversion of serine and glycine

COG id: COG0112

COG function: function code E; Glycine/serine hydroxymethyltransferase

Gene ontology:

Cell location: Cytoplasm

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the SHMT family

Homologues:

Organism=Homo sapiens, GI19923315, Length=456, Percent_Identity=45.6140350877193, Blast_Score=355, Evalue=3e-98,
Organism=Homo sapiens, GI261862352, Length=456, Percent_Identity=45.6140350877193, Blast_Score=355, Evalue=4e-98,
Organism=Homo sapiens, GI261862350, Length=456, Percent_Identity=45.6140350877193, Blast_Score=355, Evalue=4e-98,
Organism=Homo sapiens, GI261862348, Length=456, Percent_Identity=45.6140350877193, Blast_Score=355, Evalue=4e-98,
Organism=Homo sapiens, GI261862346, Length=456, Percent_Identity=44.7368421052632, Blast_Score=339, Evalue=2e-93,
Organism=Homo sapiens, GI22547186, Length=438, Percent_Identity=45.4337899543379, Blast_Score=320, Evalue=2e-87,
Organism=Homo sapiens, GI22547189, Length=423, Percent_Identity=43.0260047281324, Blast_Score=289, Evalue=3e-78,
Organism=Escherichia coli, GI1788902, Length=415, Percent_Identity=53.2530120481928, Blast_Score=414, Evalue=1e-117,
Organism=Caenorhabditis elegans, GI25144729, Length=428, Percent_Identity=43.6915887850467, Blast_Score=326, Evalue=1e-89,
Organism=Caenorhabditis elegans, GI25144732, Length=428, Percent_Identity=43.6915887850467, Blast_Score=326, Evalue=1e-89,
Organism=Saccharomyces cerevisiae, GI6319739, Length=414, Percent_Identity=45.4106280193237, Blast_Score=349, Evalue=5e-97,
Organism=Saccharomyces cerevisiae, GI6323087, Length=432, Percent_Identity=41.4351851851852, Blast_Score=327, Evalue=3e-90,
Organism=Drosophila melanogaster, GI24640005, Length=416, Percent_Identity=47.8365384615385, Blast_Score=365, Evalue=1e-101,
Organism=Drosophila melanogaster, GI221329721, Length=416, Percent_Identity=47.3557692307692, Blast_Score=364, Evalue=1e-101,

Paralogues:

None

Copy number: 3180 Molecules/Cell In: Growth Phase, Minimal Media (Based on E. coli). 300 Molecules/Cell In: Growth Phase, Minimal Media (Based on E. coli). 240 Molecules/Cell In: Growth Phase, Minimal Media (Based on E. coli). 12,000 Molecules/Cell In: Glucose minimal

Swissprot (AC and ID): GLYA1_MYCBO (P59953)

Other databases:

- EMBL:   BX248337
- RefSeq:   NP_854779.1
- ProteinModelPortal:   P59953
- SMR:   P59953
- EnsemblBacteria:   EBMYCT00000016315
- GeneID:   1090423
- GenomeReviews:   BX248333_GR
- KEGG:   mbo:Mb1123
- GeneTree:   EBGT00050000015531
- HOGENOM:   HBG301263
- OMA:   PFDYADV
- ProtClustDB:   PRK00011
- BioCyc:   MBOV233413:MB1123-MONOMER
- BRENDA:   2.1.2.1
- GO:   GO:0005737
- HAMAP:   MF_00051_B
- InterPro:   IPR015424
- InterPro:   IPR015421
- InterPro:   IPR015422
- InterPro:   IPR001085
- InterPro:   IPR019798
- Gene3D:   G3DSA:3.40.640.10
- Gene3D:   G3DSA:3.90.1150.10
- PANTHER:   PTHR11680
- PIRSF:   PIRSF000412

Pfam domain/function: PF00464 SHMT; SSF53383 PyrdxlP-dep_Trfase_major

EC number: =2.1.2.1

Molecular weight: Translated: 45002; Mature: 44871

Theoretical pI: Translated: 6.58; Mature: 6.58

Prosite motif: PS00096 SHMT

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.2 %Cys     (Translated Protein)
2.1 %Met     (Translated Protein)
2.3 %Cys+Met (Translated Protein)
0.2 %Cys     (Mature Protein)
1.9 %Met     (Mature Protein)
2.1 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSAPLAEVDPDIAELLAKELGRQRDTLEMIASENFAPRAVLQAQGSVLTNKYAEGLPGRR
CCCCCCCCCHHHHHHHHHHHCCCHHHHHHHHCCCCCCHHHHHHCCCHHHHHHHCCCCCCC
YYGGCEHVDVVENLARDRAKALFGAEFANVQPHSGAQANAAVLHALMSPGERLLGLDLAN
CCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCHHHHHHHHHHCCCCCEEEEEECC
GGHLTHGMRLNFSGKLYENGFYGVDPATHLIDMDAVRATALEFRPKVIIAGWSAYPRVLD
CCCCCCCEEEECCCEEECCCCCCCCCHHHHEEHHHHHHHHHHCCCCEEEECCCHHHHHHH
FAAFRSIADEVGAKLLVDMAHFAGLVAAGLHPSPVPHADVVSTTVHKTLGGGRSGLIVGK
HHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHHCCCCCCEEECH
QQYAKAINSAVFPGQQGGPLMHVIAGKAVALKIAATPEFADRQRRTLSGARIIADRLMAP
HHHHHHHHHHCCCCCCCCCEEEEECCCEEEEEEECCCCHHHHHHHHHHHHHHHHHHHCCC
DVAKAGVSVVSGGTDVHLVLVDLRDSPLDGQAAEDLLHEVGITVNRNAVPNDPRPPMVTS
HHHHCCCEEECCCCEEEEEEEEECCCCCCCHHHHHHHHHCCCEEECCCCCCCCCCCCEEC
GLRIGTPALATRGFGDTEFTEVADIIATALATGSSVDVSALKDRATRLARAFPLYDGLEE
CCCCCCHHHHHCCCCCCHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHCCHHH
WSLVGR
HHHCCC
>Mature Secondary Structure 
SAPLAEVDPDIAELLAKELGRQRDTLEMIASENFAPRAVLQAQGSVLTNKYAEGLPGRR
CCCCCCCCHHHHHHHHHHHCCCHHHHHHHHCCCCCCHHHHHHCCCHHHHHHHCCCCCCC
YYGGCEHVDVVENLARDRAKALFGAEFANVQPHSGAQANAAVLHALMSPGERLLGLDLAN
CCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCHHHHHHHHHHCCCCCEEEEEECC
GGHLTHGMRLNFSGKLYENGFYGVDPATHLIDMDAVRATALEFRPKVIIAGWSAYPRVLD
CCCCCCCEEEECCCEEECCCCCCCCCHHHHEEHHHHHHHHHHCCCCEEEECCCHHHHHHH
FAAFRSIADEVGAKLLVDMAHFAGLVAAGLHPSPVPHADVVSTTVHKTLGGGRSGLIVGK
HHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHHCCCCCCEEECH
QQYAKAINSAVFPGQQGGPLMHVIAGKAVALKIAATPEFADRQRRTLSGARIIADRLMAP
HHHHHHHHHHCCCCCCCCCEEEEECCCEEEEEEECCCCHHHHHHHHHHHHHHHHHHHCCC
DVAKAGVSVVSGGTDVHLVLVDLRDSPLDGQAAEDLLHEVGITVNRNAVPNDPRPPMVTS
HHHHCCCEEECCCCEEEEEEEEECCCCCCCHHHHHHHHHCCCEEECCCCCCCCCCCCEEC
GLRIGTPALATRGFGDTEFTEVADIIATALATGSSVDVSALKDRATRLARAFPLYDGLEE
CCCCCCHHHHHCCCCCCHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHCCHHH
WSLVGR
HHHCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 12788972