| Definition | Frankia sp. EAN1pec chromosome, complete genome. |
|---|---|
| Accession | NC_009921 |
| Length | 8,982,042 |
Click here to switch to the map view.
The map label for this gene is gcvT
Identifier: 158313618
GI number: 158313618
Start: 2142064
End: 2143161
Strand: Direct
Name: gcvT
Synonym: Franean1_1782
Alternate gene names: 158313618
Gene position: 2142064-2143161 (Clockwise)
Preceding gene: 158313613
Following gene: 158313622
Centisome position: 23.85
GC content: 74.5
Gene sequence:
>1098_bases ATGGGAGAGCTGCGTCGGTCCCCGCTACACGAACGGCACGTCGAGCTGGGCGCCAAGACGGCCGCCTTCGGCGGGTGGGA GATGCCGATCGAGTACGCCGGCCGGGGCGTGCTCGCCGAGCACGCGGCCGTCCGCGGCGCGGTGGGGATCTTCGACGTCA GCCACCTGGGCAAGGCCCGGGTCGCCGGCCCCGGCGCGGCCGAGTTCGTCAACACCTGCCTGACCAACGACCTGAGGCGG GTCGGCCCCGGCCAGGCGCAGTACACGCTGTGCTGCGACGAGACCGGCGGCGTCGTCGACGACCTGATCGCTTACTACTA CGCCGTCGACAACGTGTTCCTCGTGCCCAACGCGGCCAACACCGCCGAGGTCGTCCGGCGGCTCGCCGCGCAGGCGCCCG CCGGCGTCGCCGTCACCGACCTGCACACCGAGTTCGCGGTGCTCGCAGTGCAGGGCCCTGCCGCGCCGGAGGTGCTGCGC AAGCTCGGCCTGCCCGCCGACGGTGCCTACATGAGCTTCGCCGACGCCGAGTGGAAGGGGCGGCCCGTCATCGTCTGCCG CTCCGGCTACACCGGCGAGGCGGGCTTCGAGCTCCTGCCGCGCTGGGCGGACGCGGTGCCGCTCTGGGACGAGCTGCTGA CGGTGGTGACCGGCCTCGGTGGCCTGCCGTGCGGCCTCGGCGCCCGGGACACCCTGCGCACCGAGATGGGCTACCCGCTG CACGGCCAGGATCTCTCCCTGTCCATCAGCCCGGTGCAGGCCCGGTCGGGGTGGGCCGTCGGCTGGGACAAGCCGGCGTT CTGGGGCCGCGAGGCGCTGCTCGCCGAGCGCGCGGCGGGCCCGGCGCGGTCGCTGTGGGGGCTGCGCTCGAACGACCGCG GCATCCCGCGCCCGCACATGCGGGTGAGTGGCCCGGATGGTGCCGAGCTCGGCGAGGTCACCAGCGGCACGTTCTCCCCG ACCCTGCGGCAGGGCATCGGCCTTGCCCTGCTCGACCGCTCAGTGACCGCCGGCGACGAGGTGGCGGTGGACGTGCGCGG CCGCGTCTCGACGATGACGGTCGTCCGCCCGCCGTTCGTCTCCGCCTCGCCCAGGTGA
Upstream 100 bases:
>100_bases CCGTCACCGCGCCGTCATCCCGCCGGCCCGTGGCCACGTGGTCCTGTCCGGGCCGCTGCCGGCGTGCCGAAGTGACGTCC CGGGCGGCTACGCTGCCGGC
Downstream 100 bases:
>100_bases CGCCGGCGGCTCGCGTCAGCGGGTGACGGGCCGTGTCACCCGGTCACGCGTTCCGGCTCGGCGAAGTCCAGCAGGGCGGC ACGGTCCTCGGGCAGGACGA
Product: glycine cleavage system aminomethyltransferase T
Products: NA
Alternate protein names: Glycine cleavage system T protein
Number of amino acids: Translated: 365; Mature: 364
Protein sequence:
>365_residues MGELRRSPLHERHVELGAKTAAFGGWEMPIEYAGRGVLAEHAAVRGAVGIFDVSHLGKARVAGPGAAEFVNTCLTNDLRR VGPGQAQYTLCCDETGGVVDDLIAYYYAVDNVFLVPNAANTAEVVRRLAAQAPAGVAVTDLHTEFAVLAVQGPAAPEVLR KLGLPADGAYMSFADAEWKGRPVIVCRSGYTGEAGFELLPRWADAVPLWDELLTVVTGLGGLPCGLGARDTLRTEMGYPL HGQDLSLSISPVQARSGWAVGWDKPAFWGREALLAERAAGPARSLWGLRSNDRGIPRPHMRVSGPDGAELGEVTSGTFSP TLRQGIGLALLDRSVTAGDEVAVDVRGRVSTMTVVRPPFVSASPR
Sequences:
>Translated_365_residues MGELRRSPLHERHVELGAKTAAFGGWEMPIEYAGRGVLAEHAAVRGAVGIFDVSHLGKARVAGPGAAEFVNTCLTNDLRR VGPGQAQYTLCCDETGGVVDDLIAYYYAVDNVFLVPNAANTAEVVRRLAAQAPAGVAVTDLHTEFAVLAVQGPAAPEVLR KLGLPADGAYMSFADAEWKGRPVIVCRSGYTGEAGFELLPRWADAVPLWDELLTVVTGLGGLPCGLGARDTLRTEMGYPL HGQDLSLSISPVQARSGWAVGWDKPAFWGREALLAERAAGPARSLWGLRSNDRGIPRPHMRVSGPDGAELGEVTSGTFSP TLRQGIGLALLDRSVTAGDEVAVDVRGRVSTMTVVRPPFVSASPR >Mature_364_residues GELRRSPLHERHVELGAKTAAFGGWEMPIEYAGRGVLAEHAAVRGAVGIFDVSHLGKARVAGPGAAEFVNTCLTNDLRRV GPGQAQYTLCCDETGGVVDDLIAYYYAVDNVFLVPNAANTAEVVRRLAAQAPAGVAVTDLHTEFAVLAVQGPAAPEVLRK LGLPADGAYMSFADAEWKGRPVIVCRSGYTGEAGFELLPRWADAVPLWDELLTVVTGLGGLPCGLGARDTLRTEMGYPLH GQDLSLSISPVQARSGWAVGWDKPAFWGREALLAERAAGPARSLWGLRSNDRGIPRPHMRVSGPDGAELGEVTSGTFSPT LRQGIGLALLDRSVTAGDEVAVDVRGRVSTMTVVRPPFVSASPR
Specific function: The glycine cleavage system catalyzes the degradation of glycine
COG id: COG0404
COG function: function code E; Glycine cleavage system T protein (aminomethyltransferase)
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the gcvT family
Homologues:
Organism=Homo sapiens, GI44662838, Length=374, Percent_Identity=31.0160427807487, Blast_Score=141, Evalue=8e-34, Organism=Homo sapiens, GI257796258, Length=342, Percent_Identity=31.8713450292398, Blast_Score=135, Evalue=5e-32, Organism=Homo sapiens, GI257796254, Length=371, Percent_Identity=27.4932614555256, Blast_Score=108, Evalue=8e-24, Organism=Homo sapiens, GI24797151, Length=386, Percent_Identity=24.6113989637306, Blast_Score=99, Evalue=6e-21, Organism=Homo sapiens, GI257796256, Length=324, Percent_Identity=28.7037037037037, Blast_Score=98, Evalue=1e-20, Organism=Homo sapiens, GI197927446, Length=396, Percent_Identity=25, Blast_Score=86, Evalue=6e-17, Organism=Homo sapiens, GI21361378, Length=396, Percent_Identity=25, Blast_Score=86, Evalue=6e-17, Organism=Escherichia coli, GI1789272, Length=376, Percent_Identity=35.6382978723404, Blast_Score=196, Evalue=3e-51, Organism=Caenorhabditis elegans, GI17560118, Length=373, Percent_Identity=30.8310991957105, Blast_Score=139, Evalue=2e-33, Organism=Caenorhabditis elegans, GI71994045, Length=385, Percent_Identity=24.1558441558442, Blast_Score=92, Evalue=3e-19, Organism=Caenorhabditis elegans, GI71994052, Length=385, Percent_Identity=24.1558441558442, Blast_Score=92, Evalue=3e-19, Organism=Saccharomyces cerevisiae, GI6320222, Length=383, Percent_Identity=29.5039164490862, Blast_Score=142, Evalue=1e-34, Organism=Drosophila melanogaster, GI20129441, Length=388, Percent_Identity=31.9587628865979, Blast_Score=153, Evalue=1e-37,
Paralogues:
None
Copy number: 40 Molecules/Cell In: Stationary Phase, Rich Media (Based on E. coli). [C]
Swissprot (AC and ID): GCST_FRASN (A8LFB7)
Other databases:
- EMBL: CP000820 - RefSeq: YP_001506126.1 - ProteinModelPortal: A8LFB7 - SMR: A8LFB7 - GeneID: 5670184 - GenomeReviews: CP000820_GR - KEGG: fre:Franean1_1782 - HOGENOM: HBG299834 - OMA: NDISKPP - ProtClustDB: PRK00389 - BioCyc: FSP1855:FRANEAN1_1782-MONOMER - GO: GO:0005737 - HAMAP: MF_00259 - InterPro: IPR013977 - InterPro: IPR006222 - InterPro: IPR006223 - InterPro: IPR022903 - PIRSF: PIRSF006487 - TIGRFAMs: TIGR00528
Pfam domain/function: PF01571 GCV_T; PF08669 GCV_T_C
EC number: =2.1.2.10
Molecular weight: Translated: 38655; Mature: 38524
Theoretical pI: Translated: 6.17; Mature: 6.17
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.4 %Cys (Translated Protein) 1.6 %Met (Translated Protein) 3.0 %Cys+Met (Translated Protein) 1.4 %Cys (Mature Protein) 1.4 %Met (Mature Protein) 2.7 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MGELRRSPLHERHVELGAKTAAFGGWEMPIEYAGRGVLAEHAAVRGAVGIFDVSHLGKAR CCCCCCCCHHHHHHHHCCCEECCCCCCCCHHHCCCCHHHHHHHHHCCHHEEEHHHCCCCC VAGPGAAEFVNTCLTNDLRRVGPGQAQYTLCCDETGGVVDDLIAYYYAVDNVFLVPNAAN CCCCCHHHHHHHHHHHHHHHCCCCCCEEEEEECCCCCHHHHHHHHHHHHCCEEEECCCCC TAEVVRRLAAQAPAGVAVTDLHTEFAVLAVQGPAAPEVLRKLGLPADGAYMSFADAEWKG HHHHHHHHHHCCCCCEEEEECCCCEEEEEECCCCHHHHHHHHCCCCCCCEEEECCCCCCC RPVIVCRSGYTGEAGFELLPRWADAVPLWDELLTVVTGLGGLPCGLGARDTLRTEMGYPL CEEEEECCCCCCCCHHHHHHHHHCCCCHHHHHHHHHHCCCCCCCCCCCHHHHHHHCCCCC HGQDLSLSISPVQARSGWAVGWDKPAFWGREALLAERAAGPARSLWGLRSNDRGIPRPHM CCCCCEEEECCEECCCCEECCCCCCCCCCHHHHHHHHCCCCHHHHCCCCCCCCCCCCCCC RVSGPDGAELGEVTSGTFSPTLRQGIGLALLDRSVTAGDEVAVDVRGRVSTMTVVRPPFV EECCCCCCCCCCCCCCCCCHHHHHCCCEEEECCCCCCCCEEEEEECCCEEEEEEECCCCC SASPR CCCCC >Mature Secondary Structure GELRRSPLHERHVELGAKTAAFGGWEMPIEYAGRGVLAEHAAVRGAVGIFDVSHLGKAR CCCCCCCHHHHHHHHCCCEECCCCCCCCHHHCCCCHHHHHHHHHCCHHEEEHHHCCCCC VAGPGAAEFVNTCLTNDLRRVGPGQAQYTLCCDETGGVVDDLIAYYYAVDNVFLVPNAAN CCCCCHHHHHHHHHHHHHHHCCCCCCEEEEEECCCCCHHHHHHHHHHHHCCEEEECCCCC TAEVVRRLAAQAPAGVAVTDLHTEFAVLAVQGPAAPEVLRKLGLPADGAYMSFADAEWKG HHHHHHHHHHCCCCCEEEEECCCCEEEEEECCCCHHHHHHHHCCCCCCCEEEECCCCCCC RPVIVCRSGYTGEAGFELLPRWADAVPLWDELLTVVTGLGGLPCGLGARDTLRTEMGYPL CEEEEECCCCCCCCHHHHHHHHHCCCCHHHHHHHHHHCCCCCCCCCCCHHHHHHHCCCCC HGQDLSLSISPVQARSGWAVGWDKPAFWGREALLAERAAGPARSLWGLRSNDRGIPRPHM CCCCCEEEECCEECCCCEECCCCCCCCCCHHHHHHHHCCCCHHHHCCCCCCCCCCCCCCC RVSGPDGAELGEVTSGTFSPTLRQGIGLALLDRSVTAGDEVAVDVRGRVSTMTVVRPPFV EECCCCCCCCCCCCCCCCCHHHHHCCCEEEECCCCCCCCEEEEEECCCEEEEEEECCCCC SASPR CCCCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 10.0
TargetDB status: NA
Availability: NA
References: NA