Definition Ehrlichia ruminantium str. Gardel, complete genome.
Accession NC_006831
Length 1,499,920

Click here to switch to the map view.

The map label for this gene is glyA

Identifier: 58617438

GI number: 58617438

Start: 1130431

End: 1131696

Strand: Reverse

Name: glyA

Synonym: ERGA_CDS_07110

Alternate gene names: 58617438

Gene position: 1131696-1130431 (Counterclockwise)

Preceding gene: 58617439

Following gene: 58617437

Centisome position: 75.45

GC content: 34.6

Gene sequence:

>1266_bases
ATGGTTAGGTATATCTCGGATTATGATTTACAAGATGTAGATACGGAAGTATTTAAATGTATTACTGATGAATCAAATAG
ACAGAATTCTCAATTACAATTAATAGCATCTGAAAATTTTGTAAGTAAAGCAGTTTTACAAGCACAAGGTTCTATATTTA
CAAATAAGTATGCTGAAGGTTATCCTGGCAAAAGGTATTACTGTGGATGCCATTTTGCAGATATTATAGAAAATATTGCA
ATAGAGCGTTTATGTAAGTTATTTGGATGTAAGTTTGCTAATGTACAACCACATTCTGGTTCTCAAGCTAATCAAGGGGT
GTTTGCTGCTTTACTTAAACCAGGTGATACGGTGATTGGTATGTCTTTGGATTGTGGTGGGCATTTAACTCATGGTTCAG
CTCCTAGTATTTCTGGAAAATGGTTTAATGCTGTACAATATCAAGTTGACCGTGACACTGGTATGATAGATATGGATGCA
ATTGAAAAACTTGCTTTGTCCCATAATCCATCACTGATTATTGCTGGTTCTTCTTCTTATCCACGTACAATAGATTTTAA
AAGATTTAGAGAGATTGCTGATAAGGTGGGTGCATATCTTTTAGCTGATATAGCACACTATGCTGGATTGGTTGCTGCAG
GAGAATTTCCTTCACCTATTGAATATGCTCATGTTATTACATCTACTACTCATAAAACTTTACGTGGCCCTAGAGGTGCA
GTAATAATGACTAATCATGAGGATATTTATAAGAAGATTCAATCTTCTATTTTTCCTGGTATGCAAGGAGGTCCATTAAT
GCATGTAATTGCTGCTAGGGCTGTAGCATTTGGGGAAGCATTAAAGCCAGAATTTAAAGATTATGCAAAGCAGATAATTA
AAAATTCTAAAACATTGGTTAAAGTCTTTCAAGAAAGAGGTCTTAATGTAGTTACAGGTGGTACAGATTCTCATATGGTA
GTTGTTGATTTACGTCCTAAGTCTGTTACAGGGAAAGATGCAGTGCTTGCGTTAGAAAGACTAGGGATAATTTGTAATAA
AAATGCTATTCCTTTTGATCCGGAAAAACCTTTTGTAACTTCTGGATTAAGATTTGGAAGTGCTGCTGAGACATCTAGAG
GATTACAGGAACCCGAATTTGAAAAGATTGGTCATATGGTATGTGATGTTATTGATAGTTTAAAAACTACTGATGATGTT
AGATTATCTATTGAGCAAGATGTCATAAGGAGAGTTAAGGAATTGACGGATACTTTTAAGGTTTAA

Upstream 100 bases:

>100_bases
TTGTAGTAGAAGGCACAGAAGAGAGCCAGTAATAACCAGTTTTGTAACACGCTGTTAAGATTTTATTTTTTATAATGTTT
ATGCAGGAGTTATTATTACT

Downstream 100 bases:

>100_bases
TTATCTATAAAATAATGTAGTATATATTTTTGGATGTATCGTAAATAACTTGATTTTTGTATTAAATAATATTATTAATG
ATATTAATAAATGAAAAGTG

Product: serine hydroxymethyltransferase

Products: NA

Alternate protein names: SHMT; Serine methylase

Number of amino acids: Translated: 421; Mature: 421

Protein sequence:

>421_residues
MVRYISDYDLQDVDTEVFKCITDESNRQNSQLQLIASENFVSKAVLQAQGSIFTNKYAEGYPGKRYYCGCHFADIIENIA
IERLCKLFGCKFANVQPHSGSQANQGVFAALLKPGDTVIGMSLDCGGHLTHGSAPSISGKWFNAVQYQVDRDTGMIDMDA
IEKLALSHNPSLIIAGSSSYPRTIDFKRFREIADKVGAYLLADIAHYAGLVAAGEFPSPIEYAHVITSTTHKTLRGPRGA
VIMTNHEDIYKKIQSSIFPGMQGGPLMHVIAARAVAFGEALKPEFKDYAKQIIKNSKTLVKVFQERGLNVVTGGTDSHMV
VVDLRPKSVTGKDAVLALERLGIICNKNAIPFDPEKPFVTSGLRFGSAAETSRGLQEPEFEKIGHMVCDVIDSLKTTDDV
RLSIEQDVIRRVKELTDTFKV

Sequences:

>Translated_421_residues
MVRYISDYDLQDVDTEVFKCITDESNRQNSQLQLIASENFVSKAVLQAQGSIFTNKYAEGYPGKRYYCGCHFADIIENIA
IERLCKLFGCKFANVQPHSGSQANQGVFAALLKPGDTVIGMSLDCGGHLTHGSAPSISGKWFNAVQYQVDRDTGMIDMDA
IEKLALSHNPSLIIAGSSSYPRTIDFKRFREIADKVGAYLLADIAHYAGLVAAGEFPSPIEYAHVITSTTHKTLRGPRGA
VIMTNHEDIYKKIQSSIFPGMQGGPLMHVIAARAVAFGEALKPEFKDYAKQIIKNSKTLVKVFQERGLNVVTGGTDSHMV
VVDLRPKSVTGKDAVLALERLGIICNKNAIPFDPEKPFVTSGLRFGSAAETSRGLQEPEFEKIGHMVCDVIDSLKTTDDV
RLSIEQDVIRRVKELTDTFKV
>Mature_421_residues
MVRYISDYDLQDVDTEVFKCITDESNRQNSQLQLIASENFVSKAVLQAQGSIFTNKYAEGYPGKRYYCGCHFADIIENIA
IERLCKLFGCKFANVQPHSGSQANQGVFAALLKPGDTVIGMSLDCGGHLTHGSAPSISGKWFNAVQYQVDRDTGMIDMDA
IEKLALSHNPSLIIAGSSSYPRTIDFKRFREIADKVGAYLLADIAHYAGLVAAGEFPSPIEYAHVITSTTHKTLRGPRGA
VIMTNHEDIYKKIQSSIFPGMQGGPLMHVIAARAVAFGEALKPEFKDYAKQIIKNSKTLVKVFQERGLNVVTGGTDSHMV
VVDLRPKSVTGKDAVLALERLGIICNKNAIPFDPEKPFVTSGLRFGSAAETSRGLQEPEFEKIGHMVCDVIDSLKTTDDV
RLSIEQDVIRRVKELTDTFKV

Specific function: Interconversion of serine and glycine

COG id: COG0112

COG function: function code E; Glycine/serine hydroxymethyltransferase

Gene ontology:

Cell location: Cytoplasm

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the SHMT family

Homologues:

Organism=Homo sapiens, GI22547186, Length=404, Percent_Identity=46.7821782178218, Blast_Score=328, Evalue=6e-90,
Organism=Homo sapiens, GI261862352, Length=415, Percent_Identity=43.855421686747, Blast_Score=327, Evalue=2e-89,
Organism=Homo sapiens, GI261862350, Length=415, Percent_Identity=43.855421686747, Blast_Score=327, Evalue=2e-89,
Organism=Homo sapiens, GI261862348, Length=415, Percent_Identity=43.855421686747, Blast_Score=327, Evalue=2e-89,
Organism=Homo sapiens, GI19923315, Length=415, Percent_Identity=43.855421686747, Blast_Score=327, Evalue=2e-89,
Organism=Homo sapiens, GI261862346, Length=418, Percent_Identity=43.0622009569378, Blast_Score=311, Evalue=8e-85,
Organism=Homo sapiens, GI22547189, Length=390, Percent_Identity=45.1282051282051, Blast_Score=298, Evalue=9e-81,
Organism=Escherichia coli, GI1788902, Length=409, Percent_Identity=53.7897310513447, Blast_Score=438, Evalue=1e-124,
Organism=Caenorhabditis elegans, GI25144732, Length=451, Percent_Identity=43.2372505543237, Blast_Score=350, Evalue=7e-97,
Organism=Caenorhabditis elegans, GI25144729, Length=451, Percent_Identity=43.2372505543237, Blast_Score=350, Evalue=8e-97,
Organism=Saccharomyces cerevisiae, GI6323087, Length=424, Percent_Identity=44.1037735849057, Blast_Score=335, Evalue=6e-93,
Organism=Saccharomyces cerevisiae, GI6319739, Length=425, Percent_Identity=41.1764705882353, Blast_Score=324, Evalue=2e-89,
Organism=Drosophila melanogaster, GI24640005, Length=440, Percent_Identity=43.8636363636364, Blast_Score=340, Evalue=1e-93,
Organism=Drosophila melanogaster, GI221329721, Length=440, Percent_Identity=43.8636363636364, Blast_Score=340, Evalue=2e-93,

Paralogues:

None

Copy number: 3180 Molecules/Cell In: Growth Phase, Minimal Media (Based on E. coli). 300 Molecules/Cell In: Growth Phase, Minimal Media (Based on E. coli). 240 Molecules/Cell In: Growth Phase, Minimal Media (Based on E. coli). 12,000 Molecules/Cell In: Glucose minimal

Swissprot (AC and ID): GLYA_EHRRG (Q5FG30)

Other databases:

- EMBL:   CR925677
- RefSeq:   YP_196637.1
- ProteinModelPortal:   Q5FG30
- SMR:   Q5FG30
- STRING:   Q5FG30
- GeneID:   3268756
- GenomeReviews:   CR925677_GR
- KEGG:   erg:ERGA_CDS_07110
- eggNOG:   COG0112
- HOGENOM:   HBG301263
- OMA:   DYLIDMD
- ProtClustDB:   PRK00011
- BioCyc:   ERUM302409:ERGA_CDS_07110-MONOMER
- GO:   GO:0005737
- HAMAP:   MF_00051_B
- InterPro:   IPR015424
- InterPro:   IPR015421
- InterPro:   IPR015422
- InterPro:   IPR001085
- InterPro:   IPR019798
- Gene3D:   G3DSA:3.40.640.10
- Gene3D:   G3DSA:3.90.1150.10
- PANTHER:   PTHR11680
- PIRSF:   PIRSF000412

Pfam domain/function: PF00464 SHMT; SSF53383 PyrdxlP-dep_Trfase_major

EC number: =2.1.2.1

Molecular weight: Translated: 46273; Mature: 46273

Theoretical pI: Translated: 7.12; Mature: 7.12

Prosite motif: PS00096 SHMT

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.9 %Cys     (Translated Protein)
2.1 %Met     (Translated Protein)
4.0 %Cys+Met (Translated Protein)
1.9 %Cys     (Mature Protein)
2.1 %Met     (Mature Protein)
4.0 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MVRYISDYDLQDVDTEVFKCITDESNRQNSQLQLIASENFVSKAVLQAQGSIFTNKYAEG
CCCCCCCCCCCHHHHHHHHHHCCCCCCCCCEEEEEECCCHHHHHHHHHCCCCCCCCCCCC
YPGKRYYCGCHFADIIENIAIERLCKLFGCKFANVQPHSGSQANQGVFAALLKPGDTVIG
CCCCEEEECCCHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCEEEEEECCCCEEEE
MSLDCGGHLTHGSAPSISGKWFNAVQYQVDRDTGMIDMDAIEKLALSHNPSLIIAGSSSY
EEECCCCCCCCCCCCCCCCCCEEEEEEEECCCCCEEEHHHHHHHHHCCCCCEEEECCCCC
PRTIDFKRFREIADKVGAYLLADIAHYAGLVAAGEFPSPIEYAHVITSTTHKTLRGPRGA
CCCCCHHHHHHHHHHHHHHHHHHHHHHHHEEECCCCCCCHHHHHHHHHHHHHHHCCCCCE
VIMTNHEDIYKKIQSSIFPGMQGGPLMHVIAARAVAFGEALKPEFKDYAKQIIKNSKTLV
EEEECCHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHCCHHHH
KVFQERGLNVVTGGTDSHMVVVDLRPKSVTGKDAVLALERLGIICNKNAIPFDPEKPFVT
HHHHHCCCEEEECCCCCEEEEEEECCCCCCCHHHHHHHHHHCCEECCCCCCCCCCCCHHH
SGLRFGSAAETSRGLQEPEFEKIGHMVCDVIDSLKTTDDVRLSIEQDVIRRVKELTDTFK
CCCCCCCCHHHHCCCCCCHHHHHHHHHHHHHHHHCCCCHHEEEHHHHHHHHHHHHHHHHC
V
C
>Mature Secondary Structure
MVRYISDYDLQDVDTEVFKCITDESNRQNSQLQLIASENFVSKAVLQAQGSIFTNKYAEG
CCCCCCCCCCCHHHHHHHHHHCCCCCCCCCEEEEEECCCHHHHHHHHHCCCCCCCCCCCC
YPGKRYYCGCHFADIIENIAIERLCKLFGCKFANVQPHSGSQANQGVFAALLKPGDTVIG
CCCCEEEECCCHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCEEEEEECCCCEEEE
MSLDCGGHLTHGSAPSISGKWFNAVQYQVDRDTGMIDMDAIEKLALSHNPSLIIAGSSSY
EEECCCCCCCCCCCCCCCCCCEEEEEEEECCCCCEEEHHHHHHHHHCCCCCEEEECCCCC
PRTIDFKRFREIADKVGAYLLADIAHYAGLVAAGEFPSPIEYAHVITSTTHKTLRGPRGA
CCCCCHHHHHHHHHHHHHHHHHHHHHHHHEEECCCCCCCHHHHHHHHHHHHHHHCCCCCE
VIMTNHEDIYKKIQSSIFPGMQGGPLMHVIAARAVAFGEALKPEFKDYAKQIIKNSKTLV
EEEECCHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHCCHHHH
KVFQERGLNVVTGGTDSHMVVVDLRPKSVTGKDAVLALERLGIICNKNAIPFDPEKPFVT
HHHHHCCCEEEECCCCCEEEEEEECCCCCCCHHHHHHHHHHCCEECCCCCCCCCCCCHHH
SGLRFGSAAETSRGLQEPEFEKIGHMVCDVIDSLKTTDDVRLSIEQDVIRRVKELTDTFK
CCCCCCCCHHHHCCCCCCHHHHHHHHHHHHHHHHCCCCHHEEEHHHHHHHHHHHHHHHHC
V
C

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA