| Definition | Ehrlichia ruminantium str. Gardel, complete genome. |
|---|---|
| Accession | NC_006831 |
| Length | 1,499,920 |
Click here to switch to the map view.
The map label for this gene is glyA
Identifier: 58617438
GI number: 58617438
Start: 1130431
End: 1131696
Strand: Reverse
Name: glyA
Synonym: ERGA_CDS_07110
Alternate gene names: 58617438
Gene position: 1131696-1130431 (Counterclockwise)
Preceding gene: 58617439
Following gene: 58617437
Centisome position: 75.45
GC content: 34.6
Gene sequence:
>1266_bases ATGGTTAGGTATATCTCGGATTATGATTTACAAGATGTAGATACGGAAGTATTTAAATGTATTACTGATGAATCAAATAG ACAGAATTCTCAATTACAATTAATAGCATCTGAAAATTTTGTAAGTAAAGCAGTTTTACAAGCACAAGGTTCTATATTTA CAAATAAGTATGCTGAAGGTTATCCTGGCAAAAGGTATTACTGTGGATGCCATTTTGCAGATATTATAGAAAATATTGCA ATAGAGCGTTTATGTAAGTTATTTGGATGTAAGTTTGCTAATGTACAACCACATTCTGGTTCTCAAGCTAATCAAGGGGT GTTTGCTGCTTTACTTAAACCAGGTGATACGGTGATTGGTATGTCTTTGGATTGTGGTGGGCATTTAACTCATGGTTCAG CTCCTAGTATTTCTGGAAAATGGTTTAATGCTGTACAATATCAAGTTGACCGTGACACTGGTATGATAGATATGGATGCA ATTGAAAAACTTGCTTTGTCCCATAATCCATCACTGATTATTGCTGGTTCTTCTTCTTATCCACGTACAATAGATTTTAA AAGATTTAGAGAGATTGCTGATAAGGTGGGTGCATATCTTTTAGCTGATATAGCACACTATGCTGGATTGGTTGCTGCAG GAGAATTTCCTTCACCTATTGAATATGCTCATGTTATTACATCTACTACTCATAAAACTTTACGTGGCCCTAGAGGTGCA GTAATAATGACTAATCATGAGGATATTTATAAGAAGATTCAATCTTCTATTTTTCCTGGTATGCAAGGAGGTCCATTAAT GCATGTAATTGCTGCTAGGGCTGTAGCATTTGGGGAAGCATTAAAGCCAGAATTTAAAGATTATGCAAAGCAGATAATTA AAAATTCTAAAACATTGGTTAAAGTCTTTCAAGAAAGAGGTCTTAATGTAGTTACAGGTGGTACAGATTCTCATATGGTA GTTGTTGATTTACGTCCTAAGTCTGTTACAGGGAAAGATGCAGTGCTTGCGTTAGAAAGACTAGGGATAATTTGTAATAA AAATGCTATTCCTTTTGATCCGGAAAAACCTTTTGTAACTTCTGGATTAAGATTTGGAAGTGCTGCTGAGACATCTAGAG GATTACAGGAACCCGAATTTGAAAAGATTGGTCATATGGTATGTGATGTTATTGATAGTTTAAAAACTACTGATGATGTT AGATTATCTATTGAGCAAGATGTCATAAGGAGAGTTAAGGAATTGACGGATACTTTTAAGGTTTAA
Upstream 100 bases:
>100_bases TTGTAGTAGAAGGCACAGAAGAGAGCCAGTAATAACCAGTTTTGTAACACGCTGTTAAGATTTTATTTTTTATAATGTTT ATGCAGGAGTTATTATTACT
Downstream 100 bases:
>100_bases TTATCTATAAAATAATGTAGTATATATTTTTGGATGTATCGTAAATAACTTGATTTTTGTATTAAATAATATTATTAATG ATATTAATAAATGAAAAGTG
Product: serine hydroxymethyltransferase
Products: NA
Alternate protein names: SHMT; Serine methylase
Number of amino acids: Translated: 421; Mature: 421
Protein sequence:
>421_residues MVRYISDYDLQDVDTEVFKCITDESNRQNSQLQLIASENFVSKAVLQAQGSIFTNKYAEGYPGKRYYCGCHFADIIENIA IERLCKLFGCKFANVQPHSGSQANQGVFAALLKPGDTVIGMSLDCGGHLTHGSAPSISGKWFNAVQYQVDRDTGMIDMDA IEKLALSHNPSLIIAGSSSYPRTIDFKRFREIADKVGAYLLADIAHYAGLVAAGEFPSPIEYAHVITSTTHKTLRGPRGA VIMTNHEDIYKKIQSSIFPGMQGGPLMHVIAARAVAFGEALKPEFKDYAKQIIKNSKTLVKVFQERGLNVVTGGTDSHMV VVDLRPKSVTGKDAVLALERLGIICNKNAIPFDPEKPFVTSGLRFGSAAETSRGLQEPEFEKIGHMVCDVIDSLKTTDDV RLSIEQDVIRRVKELTDTFKV
Sequences:
>Translated_421_residues MVRYISDYDLQDVDTEVFKCITDESNRQNSQLQLIASENFVSKAVLQAQGSIFTNKYAEGYPGKRYYCGCHFADIIENIA IERLCKLFGCKFANVQPHSGSQANQGVFAALLKPGDTVIGMSLDCGGHLTHGSAPSISGKWFNAVQYQVDRDTGMIDMDA IEKLALSHNPSLIIAGSSSYPRTIDFKRFREIADKVGAYLLADIAHYAGLVAAGEFPSPIEYAHVITSTTHKTLRGPRGA VIMTNHEDIYKKIQSSIFPGMQGGPLMHVIAARAVAFGEALKPEFKDYAKQIIKNSKTLVKVFQERGLNVVTGGTDSHMV VVDLRPKSVTGKDAVLALERLGIICNKNAIPFDPEKPFVTSGLRFGSAAETSRGLQEPEFEKIGHMVCDVIDSLKTTDDV RLSIEQDVIRRVKELTDTFKV >Mature_421_residues MVRYISDYDLQDVDTEVFKCITDESNRQNSQLQLIASENFVSKAVLQAQGSIFTNKYAEGYPGKRYYCGCHFADIIENIA IERLCKLFGCKFANVQPHSGSQANQGVFAALLKPGDTVIGMSLDCGGHLTHGSAPSISGKWFNAVQYQVDRDTGMIDMDA IEKLALSHNPSLIIAGSSSYPRTIDFKRFREIADKVGAYLLADIAHYAGLVAAGEFPSPIEYAHVITSTTHKTLRGPRGA VIMTNHEDIYKKIQSSIFPGMQGGPLMHVIAARAVAFGEALKPEFKDYAKQIIKNSKTLVKVFQERGLNVVTGGTDSHMV VVDLRPKSVTGKDAVLALERLGIICNKNAIPFDPEKPFVTSGLRFGSAAETSRGLQEPEFEKIGHMVCDVIDSLKTTDDV RLSIEQDVIRRVKELTDTFKV
Specific function: Interconversion of serine and glycine
COG id: COG0112
COG function: function code E; Glycine/serine hydroxymethyltransferase
Gene ontology:
Cell location: Cytoplasm
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the SHMT family
Homologues:
Organism=Homo sapiens, GI22547186, Length=404, Percent_Identity=46.7821782178218, Blast_Score=328, Evalue=6e-90, Organism=Homo sapiens, GI261862352, Length=415, Percent_Identity=43.855421686747, Blast_Score=327, Evalue=2e-89, Organism=Homo sapiens, GI261862350, Length=415, Percent_Identity=43.855421686747, Blast_Score=327, Evalue=2e-89, Organism=Homo sapiens, GI261862348, Length=415, Percent_Identity=43.855421686747, Blast_Score=327, Evalue=2e-89, Organism=Homo sapiens, GI19923315, Length=415, Percent_Identity=43.855421686747, Blast_Score=327, Evalue=2e-89, Organism=Homo sapiens, GI261862346, Length=418, Percent_Identity=43.0622009569378, Blast_Score=311, Evalue=8e-85, Organism=Homo sapiens, GI22547189, Length=390, Percent_Identity=45.1282051282051, Blast_Score=298, Evalue=9e-81, Organism=Escherichia coli, GI1788902, Length=409, Percent_Identity=53.7897310513447, Blast_Score=438, Evalue=1e-124, Organism=Caenorhabditis elegans, GI25144732, Length=451, Percent_Identity=43.2372505543237, Blast_Score=350, Evalue=7e-97, Organism=Caenorhabditis elegans, GI25144729, Length=451, Percent_Identity=43.2372505543237, Blast_Score=350, Evalue=8e-97, Organism=Saccharomyces cerevisiae, GI6323087, Length=424, Percent_Identity=44.1037735849057, Blast_Score=335, Evalue=6e-93, Organism=Saccharomyces cerevisiae, GI6319739, Length=425, Percent_Identity=41.1764705882353, Blast_Score=324, Evalue=2e-89, Organism=Drosophila melanogaster, GI24640005, Length=440, Percent_Identity=43.8636363636364, Blast_Score=340, Evalue=1e-93, Organism=Drosophila melanogaster, GI221329721, Length=440, Percent_Identity=43.8636363636364, Blast_Score=340, Evalue=2e-93,
Paralogues:
None
Copy number: 3180 Molecules/Cell In: Growth Phase, Minimal Media (Based on E. coli). 300 Molecules/Cell In: Growth Phase, Minimal Media (Based on E. coli). 240 Molecules/Cell In: Growth Phase, Minimal Media (Based on E. coli). 12,000 Molecules/Cell In: Glucose minimal
Swissprot (AC and ID): GLYA_EHRRG (Q5FG30)
Other databases:
- EMBL: CR925677 - RefSeq: YP_196637.1 - ProteinModelPortal: Q5FG30 - SMR: Q5FG30 - STRING: Q5FG30 - GeneID: 3268756 - GenomeReviews: CR925677_GR - KEGG: erg:ERGA_CDS_07110 - eggNOG: COG0112 - HOGENOM: HBG301263 - OMA: DYLIDMD - ProtClustDB: PRK00011 - BioCyc: ERUM302409:ERGA_CDS_07110-MONOMER - GO: GO:0005737 - HAMAP: MF_00051_B - InterPro: IPR015424 - InterPro: IPR015421 - InterPro: IPR015422 - InterPro: IPR001085 - InterPro: IPR019798 - Gene3D: G3DSA:3.40.640.10 - Gene3D: G3DSA:3.90.1150.10 - PANTHER: PTHR11680 - PIRSF: PIRSF000412
Pfam domain/function: PF00464 SHMT; SSF53383 PyrdxlP-dep_Trfase_major
EC number: =2.1.2.1
Molecular weight: Translated: 46273; Mature: 46273
Theoretical pI: Translated: 7.12; Mature: 7.12
Prosite motif: PS00096 SHMT
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.9 %Cys (Translated Protein) 2.1 %Met (Translated Protein) 4.0 %Cys+Met (Translated Protein) 1.9 %Cys (Mature Protein) 2.1 %Met (Mature Protein) 4.0 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MVRYISDYDLQDVDTEVFKCITDESNRQNSQLQLIASENFVSKAVLQAQGSIFTNKYAEG CCCCCCCCCCCHHHHHHHHHHCCCCCCCCCEEEEEECCCHHHHHHHHHCCCCCCCCCCCC YPGKRYYCGCHFADIIENIAIERLCKLFGCKFANVQPHSGSQANQGVFAALLKPGDTVIG CCCCEEEECCCHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCEEEEEECCCCEEEE MSLDCGGHLTHGSAPSISGKWFNAVQYQVDRDTGMIDMDAIEKLALSHNPSLIIAGSSSY EEECCCCCCCCCCCCCCCCCCEEEEEEEECCCCCEEEHHHHHHHHHCCCCCEEEECCCCC PRTIDFKRFREIADKVGAYLLADIAHYAGLVAAGEFPSPIEYAHVITSTTHKTLRGPRGA CCCCCHHHHHHHHHHHHHHHHHHHHHHHHEEECCCCCCCHHHHHHHHHHHHHHHCCCCCE VIMTNHEDIYKKIQSSIFPGMQGGPLMHVIAARAVAFGEALKPEFKDYAKQIIKNSKTLV EEEECCHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHCCHHHH KVFQERGLNVVTGGTDSHMVVVDLRPKSVTGKDAVLALERLGIICNKNAIPFDPEKPFVT HHHHHCCCEEEECCCCCEEEEEEECCCCCCCHHHHHHHHHHCCEECCCCCCCCCCCCHHH SGLRFGSAAETSRGLQEPEFEKIGHMVCDVIDSLKTTDDVRLSIEQDVIRRVKELTDTFK CCCCCCCCHHHHCCCCCCHHHHHHHHHHHHHHHHCCCCHHEEEHHHHHHHHHHHHHHHHC V C >Mature Secondary Structure MVRYISDYDLQDVDTEVFKCITDESNRQNSQLQLIASENFVSKAVLQAQGSIFTNKYAEG CCCCCCCCCCCHHHHHHHHHHCCCCCCCCCEEEEEECCCHHHHHHHHHCCCCCCCCCCCC YPGKRYYCGCHFADIIENIAIERLCKLFGCKFANVQPHSGSQANQGVFAALLKPGDTVIG CCCCEEEECCCHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCEEEEEECCCCEEEE MSLDCGGHLTHGSAPSISGKWFNAVQYQVDRDTGMIDMDAIEKLALSHNPSLIIAGSSSY EEECCCCCCCCCCCCCCCCCCEEEEEEEECCCCCEEEHHHHHHHHHCCCCCEEEECCCCC PRTIDFKRFREIADKVGAYLLADIAHYAGLVAAGEFPSPIEYAHVITSTTHKTLRGPRGA CCCCCHHHHHHHHHHHHHHHHHHHHHHHHEEECCCCCCCHHHHHHHHHHHHHHHCCCCCE VIMTNHEDIYKKIQSSIFPGMQGGPLMHVIAARAVAFGEALKPEFKDYAKQIIKNSKTLV EEEECCHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHCCHHHH KVFQERGLNVVTGGTDSHMVVVDLRPKSVTGKDAVLALERLGIICNKNAIPFDPEKPFVT HHHHHCCCEEEECCCCCEEEEEEECCCCCCCHHHHHHHHHHCCEECCCCCCCCCCCCHHH SGLRFGSAAETSRGLQEPEFEKIGHMVCDVIDSLKTTDDVRLSIEQDVIRRVKELTDTFK CCCCCCCCHHHHCCCCCCHHHHHHHHHHHHHHHHCCCCHHEEEHHHHHHHHHHHHHHHHC V C
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: NA