The gene/protein map for NC_002678 is currently unavailable.
Definition Mesorhizobium loti MAFF303099 chromosome, complete genome.
Accession NC_002678
Length 7,036,071

Click here to switch to the map view.

The map label for this gene is gcvT [H]

Identifier: 13471285

GI number: 13471285

Start: 1021811

End: 1024381

Strand: Direct

Name: gcvT [H]

Synonym: mlr1213

Alternate gene names: 13471285

Gene position: 1021811-1024381 (Clockwise)

Preceding gene: 13471284

Following gene: 13471286

Centisome position: 14.52

GC content: 64.22

Gene sequence:

>2571_bases
ATGAAATCCCACGTAAAAGCGGTTGTCATCGGCGGCGGCGTCGTCGGCTGCTCGGTGCTCTATCACCTGGCCAAGGCCGG
CTGGACCGACATCATGCTGATCGAACGCTCGGAGCTCACCTCCGGCTCGTCCTGGCACGCGGCCGGCGGCTTCCACACGC
TGAACGGCGACCCCAACGTCGCCAAGCTGCAGGCCTACACCGTGCAGCTCTACAAGGAGATCGAGGAAATCTCGGGCCAG
TCCTGCTCGCTGCACCTGACCGGCGGCGTGATGATGGCCGATACGCCCGAGCGCATGGACTTCCTGCGGCTGGCCCACGC
CAAGGGCCGCTATCTCGGCATGGACACCGAGCTGATCACGCCGTCCGAAGCCAAGGCGATGTTCCCGCTGATGGACGAGA
AGAACTTCGTCGGCGCCATGTGGGACCCGGTCGAAGGCCATCTCGACCCGTCCGGCACCACCATCGCCTACTCCAAGGCG
GCGAAGAAACTCGGCGCCGAGATCGTGCTGCGCAATCGCGTCGTTGATCTCACGCAGCAGCCGGACGGCACCTGGAACGT
CGTCACCGAGCAAGGCACGGTCCACGCCGAGCATGTCGTCAACTGCGGCGGCTTGTGGGCGCGTGAGATCGGCCGCATGG
TCGGCGTCGAACTGCCGGTGCTGGCGATGGAGCACATGTACCTCTTGACCGAGCCGATGCCGGAGGTCGAGGAGTTCAAC
AAGTCGACCGGCCGCGAGATGATCGGCGTGCTCGACTTCAAAGGCGAGATCTACACCCGCCAGGAGCGCAACGGCATCCT
GCTCGGCACCTATGAAAAGGCCTGCAAGCCATGGTCGCCGGTCAACACGCCCTGGGATTTCGGCCATGAACTGCTGCCGC
CCGATCTCGACCGCATCGCGCCGTCGCTGGAAATCGGCTTCAAGCATTTCCCGGGCATCGAAAAGGCCGGCATCAAGCAG
ATCATCAATGGCCCCTTCACCTTCGCGCTCGACGGCAACCCGCTGGTCGGTCCGGTGCAGGGCCTGACCAATTTCTGGTG
CGCTTGCGCCGTCATGGCCGGCTTCAGCCAGGGCGGCGGCGTCGGCCTGGCGCTGTCGAACTGGATGGTGCATGGCGATC
CCGGCTTCGACGTCTGGGGCATGGATGTCGCCCGTTTCGGTGAATGGGCCGGCCTGCGCTACACCAACGCCAAGGTGCGC
GAAAACTACTCGCGCCGCTTCTCCATCCGCTTCCCCAATGAGGAACTGCCAGCCGCGCGGCCTGCGCAGACGACGCCGCT
CTACGACACCATGCTCGCCAATAACGCCGTCATGGGCGACTCGTGGGGGCTGGAAACCCCGCTCTGGTTCGCGCCAAAGG
GCAAGGAACCGAAAGACATCGTCTCCTTCCACCGCTCCAACGATTTCGGCCCGATCGGCGAGGAAGTGCGCGCCACGCGC
GAGCGCGTCGGCGTCACCGAGATCGCCAACTTCGCCAAATACGAAGTGTCGGGACCTGGCGCGGAAGAGTTCCTCAACCG
GCTGATGACCAACCGCATGCCGAAGACCGGCCGCATCGTGCTGACGCCAATGATCAACGAATTCGGCAAGCTGATCGGCG
ACTTTACCATCGCCAAGGCCGGTGAAGACCGCTTCATGATCTGGGGTTCGTCGGCCGCGCAGAAATACCACATGCGCTGG
TTCGAGAAGCACCTGCCGAAAGACGGTTCGGTGCGCATCCATCGCTTCGACCAGACGCTTGTCGGCCTGTCGATCGCCGG
ACCAAAGTCGCGTGATCTGCTGCAGAAGCTCGTCGACGTCGACATCTCGACCAAAGCCTTCCGCTTCATGGATTTCCGCG
AGATGGCGGTCGGCGGCGCGCCCTGCATGGTCAACCGCATCACCTATACCGGCGATCTCGGCTACGAGATCTGGATGGCG
CCGGCCTACCAGCGGCTAGTGTACAAAGCGATCAAGGATGCCGGCGAGGAGTTCGGCCTGGTCGATTTCGGTATGCGCGC
TTTGTTGTCGATGCGCCTGGAAAAGAACTTCCCGACCTGGTTCCGCGAGTTGCGGCCGATCTACGGACCGTTCGAAGGCT
CGATGGACCGCTTCATCAAGCTCGAGAAGAACGATTTCATCGGCCGCGAAGCCGCCGCCAAGGAACAGGCGGAAGGACCA
AAACTGCGCCGCGTCTCCTTCATCGTCGACGCCGCCGATGCCGACGTCATGGGTGACGAGCCGATCTGGGCCAAGGTCAG
CAAGGATTACGGCACGGTGGAGAAGCCGCATGGCTACGGCGCGCCGCGCTTCGACGACAAGGGCAAGGAAGTGCGGGGCT
CCAAGGCCGCCGAGGGCGCTTCCGCCGTGCGCGGCATCGCCGACGGCGAGTGGCGGGTGGTCGGCTGGGTGACGTCGGGC
GGCTTTGCCCACTACGTCCAGAAGTCGATGGCGCAGGGCTACGTTCCTGCAGCCCTTGCCGAGGACGAAAGCGCCGGCCT
GTTCGAGATCGAGATCCTCGGCCACCGCCGCCCGGCGCGCATCAATGTCGAGGCGCCTTTCGACCCGAGCGGCGAGAAGA
TGCGGACCTGA

Upstream 100 bases:

>100_bases
AAGGCGGCGCGCCGACCGATTTTTGATCGTGCTTGTGGTGCGTAGTGACGCCAGCGACCGAAACCTCTGATTCAATTTAC
GCAAAAACGGACCTATCTTC

Downstream 100 bases:

>100_bases
GGTTCAGCCATGGACAGCGCGGCGCCAAAGGGCAGCTTCGGTCGCCATCGCAAGATCATGCCGTTCGAGCCCGGCTCGAT
CGAGGCGCTGCGCGAAGGCT

Product: sarcosine dehydrogenase

Products: NA

Alternate protein names: Glycine cleavage system T protein [H]

Number of amino acids: Translated: 856; Mature: 856

Protein sequence:

>856_residues
MKSHVKAVVIGGGVVGCSVLYHLAKAGWTDIMLIERSELTSGSSWHAAGGFHTLNGDPNVAKLQAYTVQLYKEIEEISGQ
SCSLHLTGGVMMADTPERMDFLRLAHAKGRYLGMDTELITPSEAKAMFPLMDEKNFVGAMWDPVEGHLDPSGTTIAYSKA
AKKLGAEIVLRNRVVDLTQQPDGTWNVVTEQGTVHAEHVVNCGGLWAREIGRMVGVELPVLAMEHMYLLTEPMPEVEEFN
KSTGREMIGVLDFKGEIYTRQERNGILLGTYEKACKPWSPVNTPWDFGHELLPPDLDRIAPSLEIGFKHFPGIEKAGIKQ
IINGPFTFALDGNPLVGPVQGLTNFWCACAVMAGFSQGGGVGLALSNWMVHGDPGFDVWGMDVARFGEWAGLRYTNAKVR
ENYSRRFSIRFPNEELPAARPAQTTPLYDTMLANNAVMGDSWGLETPLWFAPKGKEPKDIVSFHRSNDFGPIGEEVRATR
ERVGVTEIANFAKYEVSGPGAEEFLNRLMTNRMPKTGRIVLTPMINEFGKLIGDFTIAKAGEDRFMIWGSSAAQKYHMRW
FEKHLPKDGSVRIHRFDQTLVGLSIAGPKSRDLLQKLVDVDISTKAFRFMDFREMAVGGAPCMVNRITYTGDLGYEIWMA
PAYQRLVYKAIKDAGEEFGLVDFGMRALLSMRLEKNFPTWFRELRPIYGPFEGSMDRFIKLEKNDFIGREAAAKEQAEGP
KLRRVSFIVDAADADVMGDEPIWAKVSKDYGTVEKPHGYGAPRFDDKGKEVRGSKAAEGASAVRGIADGEWRVVGWVTSG
GFAHYVQKSMAQGYVPAALAEDESAGLFEIEILGHRRPARINVEAPFDPSGEKMRT

Sequences:

>Translated_856_residues
MKSHVKAVVIGGGVVGCSVLYHLAKAGWTDIMLIERSELTSGSSWHAAGGFHTLNGDPNVAKLQAYTVQLYKEIEEISGQ
SCSLHLTGGVMMADTPERMDFLRLAHAKGRYLGMDTELITPSEAKAMFPLMDEKNFVGAMWDPVEGHLDPSGTTIAYSKA
AKKLGAEIVLRNRVVDLTQQPDGTWNVVTEQGTVHAEHVVNCGGLWAREIGRMVGVELPVLAMEHMYLLTEPMPEVEEFN
KSTGREMIGVLDFKGEIYTRQERNGILLGTYEKACKPWSPVNTPWDFGHELLPPDLDRIAPSLEIGFKHFPGIEKAGIKQ
IINGPFTFALDGNPLVGPVQGLTNFWCACAVMAGFSQGGGVGLALSNWMVHGDPGFDVWGMDVARFGEWAGLRYTNAKVR
ENYSRRFSIRFPNEELPAARPAQTTPLYDTMLANNAVMGDSWGLETPLWFAPKGKEPKDIVSFHRSNDFGPIGEEVRATR
ERVGVTEIANFAKYEVSGPGAEEFLNRLMTNRMPKTGRIVLTPMINEFGKLIGDFTIAKAGEDRFMIWGSSAAQKYHMRW
FEKHLPKDGSVRIHRFDQTLVGLSIAGPKSRDLLQKLVDVDISTKAFRFMDFREMAVGGAPCMVNRITYTGDLGYEIWMA
PAYQRLVYKAIKDAGEEFGLVDFGMRALLSMRLEKNFPTWFRELRPIYGPFEGSMDRFIKLEKNDFIGREAAAKEQAEGP
KLRRVSFIVDAADADVMGDEPIWAKVSKDYGTVEKPHGYGAPRFDDKGKEVRGSKAAEGASAVRGIADGEWRVVGWVTSG
GFAHYVQKSMAQGYVPAALAEDESAGLFEIEILGHRRPARINVEAPFDPSGEKMRT
>Mature_856_residues
MKSHVKAVVIGGGVVGCSVLYHLAKAGWTDIMLIERSELTSGSSWHAAGGFHTLNGDPNVAKLQAYTVQLYKEIEEISGQ
SCSLHLTGGVMMADTPERMDFLRLAHAKGRYLGMDTELITPSEAKAMFPLMDEKNFVGAMWDPVEGHLDPSGTTIAYSKA
AKKLGAEIVLRNRVVDLTQQPDGTWNVVTEQGTVHAEHVVNCGGLWAREIGRMVGVELPVLAMEHMYLLTEPMPEVEEFN
KSTGREMIGVLDFKGEIYTRQERNGILLGTYEKACKPWSPVNTPWDFGHELLPPDLDRIAPSLEIGFKHFPGIEKAGIKQ
IINGPFTFALDGNPLVGPVQGLTNFWCACAVMAGFSQGGGVGLALSNWMVHGDPGFDVWGMDVARFGEWAGLRYTNAKVR
ENYSRRFSIRFPNEELPAARPAQTTPLYDTMLANNAVMGDSWGLETPLWFAPKGKEPKDIVSFHRSNDFGPIGEEVRATR
ERVGVTEIANFAKYEVSGPGAEEFLNRLMTNRMPKTGRIVLTPMINEFGKLIGDFTIAKAGEDRFMIWGSSAAQKYHMRW
FEKHLPKDGSVRIHRFDQTLVGLSIAGPKSRDLLQKLVDVDISTKAFRFMDFREMAVGGAPCMVNRITYTGDLGYEIWMA
PAYQRLVYKAIKDAGEEFGLVDFGMRALLSMRLEKNFPTWFRELRPIYGPFEGSMDRFIKLEKNDFIGREAAAKEQAEGP
KLRRVSFIVDAADADVMGDEPIWAKVSKDYGTVEKPHGYGAPRFDDKGKEVRGSKAAEGASAVRGIADGEWRVVGWVTSG
GFAHYVQKSMAQGYVPAALAEDESAGLFEIEILGHRRPARINVEAPFDPSGEKMRT

Specific function: The glycine cleavage system catalyzes the degradation of glycine [H]

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the gcvT family [H]

Homologues:

Organism=Homo sapiens, GI24797151, Length=853, Percent_Identity=34.7010550996483, Blast_Score=533, Evalue=1e-151,
Organism=Homo sapiens, GI197927446, Length=912, Percent_Identity=27.9605263157895, Blast_Score=361, Evalue=1e-99,
Organism=Homo sapiens, GI21361378, Length=912, Percent_Identity=27.9605263157895, Blast_Score=361, Evalue=1e-99,
Organism=Homo sapiens, GI194306651, Length=744, Percent_Identity=30.7795698924731, Blast_Score=342, Evalue=1e-93,
Organism=Escherichia coli, GI1789272, Length=305, Percent_Identity=24.5901639344262, Blast_Score=75, Evalue=2e-14,
Organism=Caenorhabditis elegans, GI71994045, Length=864, Percent_Identity=25.9259259259259, Blast_Score=279, Evalue=4e-75,
Organism=Caenorhabditis elegans, GI71994052, Length=871, Percent_Identity=25.7175660160735, Blast_Score=278, Evalue=1e-74,
Organism=Caenorhabditis elegans, GI32563613, Length=883, Percent_Identity=25.1415628539071, Blast_Score=221, Evalue=1e-57,
Organism=Drosophila melanogaster, GI20130091, Length=902, Percent_Identity=28.159645232816, Blast_Score=326, Evalue=5e-89,
Organism=Drosophila melanogaster, GI28571104, Length=801, Percent_Identity=28.7141073657928, Blast_Score=311, Evalue=1e-84,

Paralogues:

None

Copy number: 40 Molecules/Cell In: Stationary Phase, Rich Media (Based on E. coli). [C]

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR013977
- InterPro:   IPR006222
- InterPro:   IPR006223
- InterPro:   IPR022903 [H]

Pfam domain/function: PF01571 GCV_T; PF08669 GCV_T_C [H]

EC number: =2.1.2.10 [H]

Molecular weight: Translated: 94859; Mature: 94859

Theoretical pI: Translated: 6.36; Mature: 6.36

Prosite motif: PS00013 PROKAR_LIPOPROTEIN

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.8 %Cys     (Translated Protein)
4.0 %Met     (Translated Protein)
4.8 %Cys+Met (Translated Protein)
0.8 %Cys     (Mature Protein)
4.0 %Met     (Mature Protein)
4.8 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKSHVKAVVIGGGVVGCSVLYHLAKAGWTDIMLIERSELTSGSSWHAAGGFHTLNGDPNV
CCCCEEEEEECCCHHHHHHHHHHHHCCCCEEEEEECCCCCCCCCCCCCCCEEEECCCCCE
AKLQAYTVQLYKEIEEISGQSCSLHLTGGVMMADTPERMDFLRLAHAKGRYLGMDTELIT
EHHHHHHHHHHHHHHHHCCCCEEEEEECCEEECCCHHHHHHHHHHHCCCCEECCCCCEEC
PSEAKAMFPLMDEKNFVGAMWDPVEGHLDPSGTTIAYSKAAKKLGAEIVLRNRVVDLTQQ
CCCCCEECCCCCCCCCCCCCCCCCCCCCCCCCCEEEHHHHHHHHCHHEEECCCEEECCCC
PDGTWNVVTEQGTVHAEHVVNCGGLWAREIGRMVGVELPVLAMEHMYLLTEPMPEVEEFN
CCCCEEEEECCCCEEHHHHHCCCCHHHHHHHHHHCCCCHHHHHHHHHHHCCCCHHHHHHH
KSTGREMIGVLDFKGEIYTRQERNGILLGTYEKACKPWSPVNTPWDFGHELLPPDLDRIA
HHCCCCEEEEEECCCCEEEEECCCCEEEECHHHHCCCCCCCCCCHHCCCCCCCCCHHHHC
PSLEIGFKHFPGIEKAGIKQIINGPFTFALDGNPLVGPVQGLTNFWCACAVMAGFSQGGG
CCHHCCHHHCCCCCHHHHHHHHCCCEEEEECCCCCCCHHHHHHHHHHHHHHHHCCCCCCC
VGLALSNWMVHGDPGFDVWGMDVARFGEWAGLRYTNAKVRENYSRRFSIRFPNEELPAAR
EEEEEECEEEECCCCCCCCCCHHHHHCCCCCCEECCHHHHCCCCCEEEEECCCCCCCCCC
PAQTTPLYDTMLANNAVMGDSWGLETPLWFAPKGKEPKDIVSFHRSNDFGPIGEEVRATR
CCCCCCHHHHHHHCCCEECCCCCCCCCEEECCCCCCHHHHHHHHCCCCCCCCCHHHHHHH
ERVGVTEIANFAKYEVSGPGAEEFLNRLMTNRMPKTGRIVLTPMINEFGKLIGDFTIAKA
HHCCHHHHHHHHEEECCCCCHHHHHHHHHHHCCCCCCCEEEEHHHHHHHHHHHCEEEEEC
GEDRFMIWGSSAAQKYHMRWFEKHLPKDGSVRIHRFDQTLVGLSIAGPKSRDLLQKLVDV
CCCEEEEECCHHHHHHHHHHHHHHCCCCCCEEEEEECCEEEEEEECCCCHHHHHHHHHCC
DISTKAFRFMDFREMAVGGAPCMVNRITYTGDLGYEIWMAPAYQRLVYKAIKDAGEEFGL
CCCCHHHHHHHHHHHHCCCCCEEEEEEEEECCCCEEEEECHHHHHHHHHHHHHCHHHCCH
VDFGMRALLSMRLEKNFPTWFRELRPIYGPFEGSMDRFIKLEKNDFIGREAAAKEQAEGP
HHHHHHHHHHHHHHCCCCHHHHHHCCCCCCCCCCCCCEEEECCCCCCCCHHHHHHHCCCC
KLRRVSFIVDAADADVMGDEPIWAKVSKDYGTVEKPHGYGAPRFDDKGKEVRGSKAAEGA
CEEEEEEEEECCCCCCCCCCCCEEEECCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCH
SAVRGIADGEWRVVGWVTSGGFAHYVQKSMAQGYVPAALAEDESAGLFEIEILGHRRPAR
HHHCCCCCCCEEEEEEEECCCHHHHHHHHHHCCCCCCCCCCCCCCCEEEEEEECCCCCCE
INVEAPFDPSGEKMRT
EEEECCCCCCCCCCCC
>Mature Secondary Structure
MKSHVKAVVIGGGVVGCSVLYHLAKAGWTDIMLIERSELTSGSSWHAAGGFHTLNGDPNV
CCCCEEEEEECCCHHHHHHHHHHHHCCCCEEEEEECCCCCCCCCCCCCCCEEEECCCCCE
AKLQAYTVQLYKEIEEISGQSCSLHLTGGVMMADTPERMDFLRLAHAKGRYLGMDTELIT
EHHHHHHHHHHHHHHHHCCCCEEEEEECCEEECCCHHHHHHHHHHHCCCCEECCCCCEEC
PSEAKAMFPLMDEKNFVGAMWDPVEGHLDPSGTTIAYSKAAKKLGAEIVLRNRVVDLTQQ
CCCCCEECCCCCCCCCCCCCCCCCCCCCCCCCCEEEHHHHHHHHCHHEEECCCEEECCCC
PDGTWNVVTEQGTVHAEHVVNCGGLWAREIGRMVGVELPVLAMEHMYLLTEPMPEVEEFN
CCCCEEEEECCCCEEHHHHHCCCCHHHHHHHHHHCCCCHHHHHHHHHHHCCCCHHHHHHH
KSTGREMIGVLDFKGEIYTRQERNGILLGTYEKACKPWSPVNTPWDFGHELLPPDLDRIA
HHCCCCEEEEEECCCCEEEEECCCCEEEECHHHHCCCCCCCCCCHHCCCCCCCCCHHHHC
PSLEIGFKHFPGIEKAGIKQIINGPFTFALDGNPLVGPVQGLTNFWCACAVMAGFSQGGG
CCHHCCHHHCCCCCHHHHHHHHCCCEEEEECCCCCCCHHHHHHHHHHHHHHHHCCCCCCC
VGLALSNWMVHGDPGFDVWGMDVARFGEWAGLRYTNAKVRENYSRRFSIRFPNEELPAAR
EEEEEECEEEECCCCCCCCCCHHHHHCCCCCCEECCHHHHCCCCCEEEEECCCCCCCCCC
PAQTTPLYDTMLANNAVMGDSWGLETPLWFAPKGKEPKDIVSFHRSNDFGPIGEEVRATR
CCCCCCHHHHHHHCCCEECCCCCCCCCEEECCCCCCHHHHHHHHCCCCCCCCCHHHHHHH
ERVGVTEIANFAKYEVSGPGAEEFLNRLMTNRMPKTGRIVLTPMINEFGKLIGDFTIAKA
HHCCHHHHHHHHEEECCCCCHHHHHHHHHHHCCCCCCCEEEEHHHHHHHHHHHCEEEEEC
GEDRFMIWGSSAAQKYHMRWFEKHLPKDGSVRIHRFDQTLVGLSIAGPKSRDLLQKLVDV
CCCEEEEECCHHHHHHHHHHHHHHCCCCCCEEEEEECCEEEEEEECCCCHHHHHHHHHCC
DISTKAFRFMDFREMAVGGAPCMVNRITYTGDLGYEIWMAPAYQRLVYKAIKDAGEEFGL
CCCCHHHHHHHHHHHHCCCCCEEEEEEEEECCCCEEEEECHHHHHHHHHHHHHCHHHCCH
VDFGMRALLSMRLEKNFPTWFRELRPIYGPFEGSMDRFIKLEKNDFIGREAAAKEQAEGP
HHHHHHHHHHHHHHCCCCHHHHHHCCCCCCCCCCCCCEEEECCCCCCCCHHHHHHHCCCC
KLRRVSFIVDAADADVMGDEPIWAKVSKDYGTVEKPHGYGAPRFDDKGKEVRGSKAAEGA
CEEEEEEEEECCCCCCCCCCCCEEEECCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCH
SAVRGIADGEWRVVGWVTSGGFAHYVQKSMAQGYVPAALAEDESAGLFEIEILGHRRPAR
HHHCCCCCCCEEEEEEEECCCHHHHHHHHHHCCCCCCCCCCCCCCCEEEEEEECCCCCCE
INVEAPFDPSGEKMRT
EEEECCCCCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA