Definition Ruegeria sp. TM1040, complete genome.
Accession NC_008044
Length 3,200,938

Click here to switch to the map view.

The map label for this gene is glcB [H]

Identifier: 99080552

GI number: 99080552

Start: 763923

End: 766052

Strand: Reverse

Name: glcB [H]

Synonym: TM1040_0711

Alternate gene names: 99080552

Gene position: 766052-763923 (Counterclockwise)

Preceding gene: 99080554

Following gene: 99080551

Centisome position: 23.93

GC content: 60.85

Gene sequence:

>2130_bases
ATGAGCCGGATTGAACGCAATGGACTTCAGGTCGCCTCCGAACTGGTGGCTTTTGTAGAGGACCAGGCGCTGCCGGGCAC
CGGCGTCAGCAAGGAGGCGTTCTGGGCCGGGCTTGCGGGGCTGGTCGAGGGTATGGGCGATGAAAACCGCGCCCTTCTTG
CCAAACGTGCGGAGATTCAGGGACAGATCGACGCCTGGCATCTGGAACACCGTGGCCAGCCGCATGATGCCGCAGCCTAC
AAGGACTTTTTGACCGAGATTGGCTATTTGGTGCCGGAGGGACCGGATTTTGAGGTGGAAACCCAGAATGTTGACCCCGA
GATCGCGCATGTACCTGGGCCGCAGCTGGTGGTTCCGATCACCAACGCCCGCTTTGCGCTCAATGCAGCGAACGCCCGCT
GGGGCAGTCTTTATGATGCGCTCTATGGCACCGATGCCATGGGCGATCTTCCGAGCGGTTCGGGTTACGATGCGGAGCGT
GGCGCACGGGTGATCGCATGGGGACGTCAATTCCTCGATGAGACCTTCCCGCTTACGGCGGGCTCCTGGTCCGATGTGGC
AGCGCTTCAGGTGCAGGATGGCGCCCTCGCGCCCGCACTCAAGGACGCAACCCAGTTTGCAGGCTACGCTGGCGACGCGA
CCAGTCCGCGCCGCATCCTGCTGAAAAACAACGGCCTGCACGCGATCCTCGAGATCGACGCAAGCGGCAACATCGGCAAA
GGCGATGCCGCCAACATCAACGACATCACGCTTGAATCGGCGCTCTCGACCATCATGGACTGCGAGGATTCGGTCGCCTG
TGTGGATGCCGAAGACAAGGTTAGCGCCTATGCCAACTGGCTAGGCCTGATGAAGCGCGACCTTAGTGAAGAGGTCAGCA
AGGGCGGCAAGACCTTTACCCGCGTATTGAACGACGACCTGTCCTACACCACCCCCACCGGCGAGGCGTCGAAGCTCAAG
GGGCGTTCTCTCCTGTTGGTGCGCAATGTCGGCCACCTGATGACAAACCCGGCCATCCTGGACAGTGCGGGCCGCGAGGC
GGGCGAAGGCCTGATGGATGCGATGATCACTGTCATGGTGGCCATGCATGACCTAAAATCCGAAGGCGGCAACTCGCTGC
ATGGGTCGGTCTATGTGGTGAAACCTAAGATGCACGGTCCCGAAGAGGTCGCCTTTGCGGTAAAGATATTTGATCACGTT
GAAGACGCACTGGGCCTGCCGCGCAACACGGTCAAGATCGGCATCATGGACGAGGAACGCCGCACCTCGGCCAACCTCAA
GGAATGCATCCGTGCCGCAAAATCGCGGGTGGCCTTCATCAACACCGGGTTCCTCGATCGCACCGGCGATGAGATCCACA
CCTCGATGGAAGCAGGCGCAATGCTGCCCAAGGGCGAGATGAAATCGACCGCGTGGATTGCCTCTTATGAGGATCGCAAC
GTCGATATCGGTCTGGCCTGTGGTCTGCAGGGGCGTGCCCAGATTGGCAAGGGCATGTGGGCGATGCCTGACCGTATGGG
CGAGATGCTGGACGCAAAGATCGGCCACCCGAAATCCGGCGCAACCTGCGCCTGGGTGCCCTCGCCGACCGCTGCGACCC
TGCATGCCACCCATTATCACAAGGTGGATGTCCTGAGCCGCCAGAACGAGCTCAAGGCTGAGGGCGCGCGGGGCACATTG
GATGATCTGCTCACGATCCCGGTAATGGCAGGCCAGAACCTCTCGGACGAGGCCATTACGCGTGAAATCGAGAACAACGC
TCAAGGCATTCTCGGATATGTGGTGCGCTGGGTAGATCAGGGTGTGGGCTGCTCCAAAGTGCCAGACATCAATGATGTGG
GGCTGATGGAAGACCGGGCGACCTGCCGGATCTCTAGTCAGGCCTTGGCGAACTGGCTGCATCATGGCGTTGTCTCCGAA
CAGCAAGTTATGGCCGCGATGCAGAAAATGGCCGCCGTTGTGGATGGCCAAAACGCTGCCGATCCTTCTTATCGCCCGAT
GGCTCCCGGGTTCGACGGCATCGCCTTTCAGGCCGCCTGCGATCTGGTGTTCAAGGGCCGCATTCAGCCCTCCGGCTATA
CGGAGCCGGTGCTGCATGCCCGCCGTCTGGAACTGAAGGCTCAGGGCTAA

Upstream 100 bases:

>100_bases
CAGATGCGTTTGCATTTCCAGAGAGCACGATTTGTTGCCGATCGGAAACTTATCGCCTATCTAATCGCATGCAATCGTGC
ACCATCAGAAGGAGAGAACA

Downstream 100 bases:

>100_bases
CAGCCCTTGATACAATGTCTCAGCCCGAAGGGGCTGAGACATGAGGTCTGTGCATAGGTGAACAGGCCAATGCGCCTCGC
CTCGGGCTTGCGCAAAAGAC

Product: malate synthase G

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 709; Mature: 708

Protein sequence:

>709_residues
MSRIERNGLQVASELVAFVEDQALPGTGVSKEAFWAGLAGLVEGMGDENRALLAKRAEIQGQIDAWHLEHRGQPHDAAAY
KDFLTEIGYLVPEGPDFEVETQNVDPEIAHVPGPQLVVPITNARFALNAANARWGSLYDALYGTDAMGDLPSGSGYDAER
GARVIAWGRQFLDETFPLTAGSWSDVAALQVQDGALAPALKDATQFAGYAGDATSPRRILLKNNGLHAILEIDASGNIGK
GDAANINDITLESALSTIMDCEDSVACVDAEDKVSAYANWLGLMKRDLSEEVSKGGKTFTRVLNDDLSYTTPTGEASKLK
GRSLLLVRNVGHLMTNPAILDSAGREAGEGLMDAMITVMVAMHDLKSEGGNSLHGSVYVVKPKMHGPEEVAFAVKIFDHV
EDALGLPRNTVKIGIMDEERRTSANLKECIRAAKSRVAFINTGFLDRTGDEIHTSMEAGAMLPKGEMKSTAWIASYEDRN
VDIGLACGLQGRAQIGKGMWAMPDRMGEMLDAKIGHPKSGATCAWVPSPTAATLHATHYHKVDVLSRQNELKAEGARGTL
DDLLTIPVMAGQNLSDEAITREIENNAQGILGYVVRWVDQGVGCSKVPDINDVGLMEDRATCRISSQALANWLHHGVVSE
QQVMAAMQKMAAVVDGQNAADPSYRPMAPGFDGIAFQAACDLVFKGRIQPSGYTEPVLHARRLELKAQG

Sequences:

>Translated_709_residues
MSRIERNGLQVASELVAFVEDQALPGTGVSKEAFWAGLAGLVEGMGDENRALLAKRAEIQGQIDAWHLEHRGQPHDAAAY
KDFLTEIGYLVPEGPDFEVETQNVDPEIAHVPGPQLVVPITNARFALNAANARWGSLYDALYGTDAMGDLPSGSGYDAER
GARVIAWGRQFLDETFPLTAGSWSDVAALQVQDGALAPALKDATQFAGYAGDATSPRRILLKNNGLHAILEIDASGNIGK
GDAANINDITLESALSTIMDCEDSVACVDAEDKVSAYANWLGLMKRDLSEEVSKGGKTFTRVLNDDLSYTTPTGEASKLK
GRSLLLVRNVGHLMTNPAILDSAGREAGEGLMDAMITVMVAMHDLKSEGGNSLHGSVYVVKPKMHGPEEVAFAVKIFDHV
EDALGLPRNTVKIGIMDEERRTSANLKECIRAAKSRVAFINTGFLDRTGDEIHTSMEAGAMLPKGEMKSTAWIASYEDRN
VDIGLACGLQGRAQIGKGMWAMPDRMGEMLDAKIGHPKSGATCAWVPSPTAATLHATHYHKVDVLSRQNELKAEGARGTL
DDLLTIPVMAGQNLSDEAITREIENNAQGILGYVVRWVDQGVGCSKVPDINDVGLMEDRATCRISSQALANWLHHGVVSE
QQVMAAMQKMAAVVDGQNAADPSYRPMAPGFDGIAFQAACDLVFKGRIQPSGYTEPVLHARRLELKAQG
>Mature_708_residues
SRIERNGLQVASELVAFVEDQALPGTGVSKEAFWAGLAGLVEGMGDENRALLAKRAEIQGQIDAWHLEHRGQPHDAAAYK
DFLTEIGYLVPEGPDFEVETQNVDPEIAHVPGPQLVVPITNARFALNAANARWGSLYDALYGTDAMGDLPSGSGYDAERG
ARVIAWGRQFLDETFPLTAGSWSDVAALQVQDGALAPALKDATQFAGYAGDATSPRRILLKNNGLHAILEIDASGNIGKG
DAANINDITLESALSTIMDCEDSVACVDAEDKVSAYANWLGLMKRDLSEEVSKGGKTFTRVLNDDLSYTTPTGEASKLKG
RSLLLVRNVGHLMTNPAILDSAGREAGEGLMDAMITVMVAMHDLKSEGGNSLHGSVYVVKPKMHGPEEVAFAVKIFDHVE
DALGLPRNTVKIGIMDEERRTSANLKECIRAAKSRVAFINTGFLDRTGDEIHTSMEAGAMLPKGEMKSTAWIASYEDRNV
DIGLACGLQGRAQIGKGMWAMPDRMGEMLDAKIGHPKSGATCAWVPSPTAATLHATHYHKVDVLSRQNELKAEGARGTLD
DLLTIPVMAGQNLSDEAITREIENNAQGILGYVVRWVDQGVGCSKVPDINDVGLMEDRATCRISSQALANWLHHGVVSEQ
QVMAAMQKMAAVVDGQNAADPSYRPMAPGFDGIAFQAACDLVFKGRIQPSGYTEPVLHARRLELKAQG

Specific function: Accounts For Almost The Entire Malate-Synthesizing Activity In Cells Metabolizing Glyoxylate. [C]

COG id: COG2225

COG function: function code C; Malate synthase

Gene ontology:

Cell location: Cytoplasm [H]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the malate synthase family. GlcB subfamily [H]

Homologues:

Organism=Escherichia coli, GI1789348, Length=718, Percent_Identity=57.2423398328691, Blast_Score=811, Evalue=0.0,
Organism=Caenorhabditis elegans, GI17561814, Length=346, Percent_Identity=26.0115606936416, Blast_Score=82, Evalue=1e-15,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR011076
- InterPro:   IPR001465
- InterPro:   IPR006253 [H]

Pfam domain/function: PF01274 Malate_synthase [H]

EC number: =2.3.3.9 [H]

Molecular weight: Translated: 76155; Mature: 76024

Theoretical pI: Translated: 4.87; Mature: 4.87

Prosite motif: PS00589 PTS_HPR_SER

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.1 %Cys     (Translated Protein)
3.5 %Met     (Translated Protein)
4.7 %Cys+Met (Translated Protein)
1.1 %Cys     (Mature Protein)
3.4 %Met     (Mature Protein)
4.5 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSRIERNGLQVASELVAFVEDQALPGTGVSKEAFWAGLAGLVEGMGDENRALLAKRAEIQ
CCCCHHHHHHHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHCCCCCCHHHHHHHHHHC
GQIDAWHLEHRGQPHDAAAYKDFLTEIGYLVPEGPDFEVETQNVDPEIAHVPGPQLVVPI
CCCEEEECCCCCCCCHHHHHHHHHHHHCCCCCCCCCCEEECCCCCCCEEECCCCEEEEEE
TNARFALNAANARWGSLYDALYGTDAMGDLPSGSGYDAERGARVIAWGRQFLDETFPLTA
CCCEEEEECCCCCHHHHHHHHHCCCCCCCCCCCCCCCHHHCCEEEEHHHHHHHHCCCCCC
GSWSDVAALQVQDGALAPALKDATQFAGYAGDATSPRRILLKNNGLHAILEIDASGNIGK
CCCCCEEEEEECCCCCCHHHHHHHHHCCCCCCCCCCCEEEEECCCEEEEEEEECCCCCCC
GDAANINDITLESALSTIMDCEDSVACVDAEDKVSAYANWLGLMKRDLSEEVSKGGKTFT
CCCCCCCHHHHHHHHHHHHCCCCCEEEECCHHHHHHHHHHHHHHHHHHHHHHHCCCHHHH
RVLNDDLSYTTPTGEASKLKGRSLLLVRNVGHLMTNPAILDSAGREAGEGLMDAMITVMV
HHHHCCCCCCCCCCCHHHCCCCEEEEEECCHHHHCCCHHHHHCCCHHHHHHHHHHHHHHH
AMHDLKSEGGNSLHGSVYVVKPKMHGPEEVAFAVKIFDHVEDALGLPRNTVKIGIMDEER
HHHHHHCCCCCCCCCCEEEEECCCCCHHHHHHHHHHHHHHHHHHCCCCCEEEEEEECCHH
RTSANLKECIRAAKSRVAFINTGFLDRTGDEIHTSMEAGAMLPKGEMKSTAWIASYEDRN
HHHCCHHHHHHHHHCCEEEEECCCCCCCCHHHHHHHHHCCCCCCCCCCCEEEEEECCCCC
VDIGLACGLQGRAQIGKGMWAMPDRMGEMLDAKIGHPKSGATCAWVPSPTAATLHATHYH
CEEEEEECCCCHHHHCCCCCCCCHHHHHHHHHHCCCCCCCCEEEECCCCCCEEEEECCCC
KVDVLSRQNELKAEGARGTLDDLLTIPVMAGQNLSDEAITREIENNAQGILGYVVRWVDQ
HHHHHHCCHHHHCCCCCCCHHHHHHHHHHCCCCCCHHHHHHHHHHCHHHHHHHHHHHHHC
GVGCSKVPDINDVGLMEDRATCRISSQALANWLHHGVVSEQQVMAAMQKMAAVVDGQNAA
CCCCCCCCCCCCCCCCCCCCCEEECHHHHHHHHHHCCCCHHHHHHHHHHHHHHHCCCCCC
DPSYRPMAPGFDGIAFQAACDLVFKGRIQPSGYTEPVLHARRLELKAQG
CCCCCCCCCCCCCHHHHHHHHHHEECCCCCCCCCCHHHHHHHHEEECCC
>Mature Secondary Structure 
SRIERNGLQVASELVAFVEDQALPGTGVSKEAFWAGLAGLVEGMGDENRALLAKRAEIQ
CCCHHHHHHHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHCCCCCCHHHHHHHHHHC
GQIDAWHLEHRGQPHDAAAYKDFLTEIGYLVPEGPDFEVETQNVDPEIAHVPGPQLVVPI
CCCEEEECCCCCCCCHHHHHHHHHHHHCCCCCCCCCCEEECCCCCCCEEECCCCEEEEEE
TNARFALNAANARWGSLYDALYGTDAMGDLPSGSGYDAERGARVIAWGRQFLDETFPLTA
CCCEEEEECCCCCHHHHHHHHHCCCCCCCCCCCCCCCHHHCCEEEEHHHHHHHHCCCCCC
GSWSDVAALQVQDGALAPALKDATQFAGYAGDATSPRRILLKNNGLHAILEIDASGNIGK
CCCCCEEEEEECCCCCCHHHHHHHHHCCCCCCCCCCCEEEEECCCEEEEEEEECCCCCCC
GDAANINDITLESALSTIMDCEDSVACVDAEDKVSAYANWLGLMKRDLSEEVSKGGKTFT
CCCCCCCHHHHHHHHHHHHCCCCCEEEECCHHHHHHHHHHHHHHHHHHHHHHHCCCHHHH
RVLNDDLSYTTPTGEASKLKGRSLLLVRNVGHLMTNPAILDSAGREAGEGLMDAMITVMV
HHHHCCCCCCCCCCCHHHCCCCEEEEEECCHHHHCCCHHHHHCCCHHHHHHHHHHHHHHH
AMHDLKSEGGNSLHGSVYVVKPKMHGPEEVAFAVKIFDHVEDALGLPRNTVKIGIMDEER
HHHHHHCCCCCCCCCCEEEEECCCCCHHHHHHHHHHHHHHHHHHCCCCCEEEEEEECCHH
RTSANLKECIRAAKSRVAFINTGFLDRTGDEIHTSMEAGAMLPKGEMKSTAWIASYEDRN
HHHCCHHHHHHHHHCCEEEEECCCCCCCCHHHHHHHHHCCCCCCCCCCCEEEEEECCCCC
VDIGLACGLQGRAQIGKGMWAMPDRMGEMLDAKIGHPKSGATCAWVPSPTAATLHATHYH
CEEEEEECCCCHHHHCCCCCCCCHHHHHHHHHHCCCCCCCCEEEECCCCCCEEEEECCCC
KVDVLSRQNELKAEGARGTLDDLLTIPVMAGQNLSDEAITREIENNAQGILGYVVRWVDQ
HHHHHHCCHHHHCCCCCCCHHHHHHHHHHCCCCCCHHHHHHHHHHCHHHHHHHHHHHHHC
GVGCSKVPDINDVGLMEDRATCRISSQALANWLHHGVVSEQQVMAAMQKMAAVVDGQNAA
CCCCCCCCCCCCCCCCCCCCCEEECHHHHHHHHHHCCCCHHHHHHHHHHHHHHHCCCCCC
DPSYRPMAPGFDGIAFQAACDLVFKGRIQPSGYTEPVLHARRLELKAQG
CCCCCCCCCCCCCHHHHHHHHHHEECCCCCCCCCCHHHHHHHHEEECCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA