| Definition | Tropheryma whipplei TW08/27, complete genome. |
|---|---|
| Accession | NC_004551 |
| Length | 925,938 |
Click here to switch to the map view.
The map label for this gene is gcvT [H]
Identifier: 28572801
GI number: 28572801
Start: 751396
End: 752466
Strand: Reverse
Name: gcvT [H]
Synonym: TW659
Alternate gene names: 28572801
Gene position: 752466-751396 (Counterclockwise)
Preceding gene: 28572802
Following gene: 28572800
Centisome position: 81.27
GC content: 46.78
Gene sequence:
>1071_bases ATGGCCATGACTAGGGTATCTCCGCTTGATAACGAGCATAAAGCGCTTGGCGCGATTTTCACCTGTTTCGCGGGCTATAA GTTGCCAGTGCGGTACAAGTCTGATATTGCGGAACACACTGCTGTTCGCCAGGGTTGTGGAATATTTGATCTGTCACATA TGGCAGAAATATTTGTTTCAGGTGTGAACGCAGGCCTGGAATTGGATATTGCTCTCACAGGGCACTTCTCTGATATGACT TGTGGGCGCGCAAAATACACGCTTATTTTGAATGAACAGGGCGGCATAGAGGATGATCTGATTGTCTACCGAATTGATGA TAAAAATTACATGGTTGTTGCAAATGCGATAAATCGCAAGAAGGTGTTTTCTCTCTTGCGAGATAGAGTGCATACATCAG ATATCAAGGATGAGACTGATTCGATATCTCTTGTAGCTGTGCAGGGCCCGGAATCTGAGAGTCTAATAAGAGATCTATTT CATGAATCCGGTAATTTACGCTATTTCTCCCACCGGTGTTATCCACACGGCGGAACGGATCGTTCCGAGAAATTAAGTTG TTCAATTGTTGCCCGAACGGGATACACAGGGGAAGATGGCTTTGAAATCTTTACCCCAAACGATAGCGTGGTATCTATTT GGCGAGCCCTCATAGAGCGAGGTGCGACTCCTTGCGGACTCGCTGCTCGCAATACCCTTCGAATAGAGGCGGGTATGCCT TTGTACGGCCACGAACTTCGGGCGGATTTAAATCCAGTGCAGGCAGGACTCGAGAGATTTATTTCGCCTCCGTGTATCGG TTGTGACAGAATAAATCATTCAGGTGATTTTCCCTTACTCGTTGGCTTATCTATCGACGGGCGCCGTGCTGCCCGTGAGG GATATACCATTTACAGCAGCTCTAATATCCCCGTTGGGACTGTTACAAGTGGATGTTTCTCTCCAACCTTGGGCTGCTCA ATCGCTATGGCTTATGTTAAAGCTAAAGCGCGCAGTGCGCAACTTTATATTGATATTAGAGGCTCCATGACGCCATGTAA AGTTGTTCCCATGCCGTTTTATAGACGTTGA
Upstream 100 bases:
>100_bases GGTGCAGTCCAATCTCACGATACTCTTCAGTCTCACACTTGTACCCCAGTCTATCCGTATCTTTCAGGAGTTCAACAGAC ATGTAGTACCCTAGTCAAGG
Downstream 100 bases:
>100_bases AGGTAAAGTACTAGTTCGAGTGTAATTTAGAGACGGCGGGATTTTTGGAGGCAGAGTGTTCGATGAAAGTGACCTGGTCT ACAGCAAGGAACATGAGTGG
Product: aminomethyltransferase gcvT
Products: NA
Alternate protein names: Glycine cleavage system T protein [H]
Number of amino acids: Translated: 356; Mature: 355
Protein sequence:
>356_residues MAMTRVSPLDNEHKALGAIFTCFAGYKLPVRYKSDIAEHTAVRQGCGIFDLSHMAEIFVSGVNAGLELDIALTGHFSDMT CGRAKYTLILNEQGGIEDDLIVYRIDDKNYMVVANAINRKKVFSLLRDRVHTSDIKDETDSISLVAVQGPESESLIRDLF HESGNLRYFSHRCYPHGGTDRSEKLSCSIVARTGYTGEDGFEIFTPNDSVVSIWRALIERGATPCGLAARNTLRIEAGMP LYGHELRADLNPVQAGLERFISPPCIGCDRINHSGDFPLLVGLSIDGRRAAREGYTIYSSSNIPVGTVTSGCFSPTLGCS IAMAYVKAKARSAQLYIDIRGSMTPCKVVPMPFYRR
Sequences:
>Translated_356_residues MAMTRVSPLDNEHKALGAIFTCFAGYKLPVRYKSDIAEHTAVRQGCGIFDLSHMAEIFVSGVNAGLELDIALTGHFSDMT CGRAKYTLILNEQGGIEDDLIVYRIDDKNYMVVANAINRKKVFSLLRDRVHTSDIKDETDSISLVAVQGPESESLIRDLF HESGNLRYFSHRCYPHGGTDRSEKLSCSIVARTGYTGEDGFEIFTPNDSVVSIWRALIERGATPCGLAARNTLRIEAGMP LYGHELRADLNPVQAGLERFISPPCIGCDRINHSGDFPLLVGLSIDGRRAAREGYTIYSSSNIPVGTVTSGCFSPTLGCS IAMAYVKAKARSAQLYIDIRGSMTPCKVVPMPFYRR >Mature_355_residues AMTRVSPLDNEHKALGAIFTCFAGYKLPVRYKSDIAEHTAVRQGCGIFDLSHMAEIFVSGVNAGLELDIALTGHFSDMTC GRAKYTLILNEQGGIEDDLIVYRIDDKNYMVVANAINRKKVFSLLRDRVHTSDIKDETDSISLVAVQGPESESLIRDLFH ESGNLRYFSHRCYPHGGTDRSEKLSCSIVARTGYTGEDGFEIFTPNDSVVSIWRALIERGATPCGLAARNTLRIEAGMPL YGHELRADLNPVQAGLERFISPPCIGCDRINHSGDFPLLVGLSIDGRRAAREGYTIYSSSNIPVGTVTSGCFSPTLGCSI AMAYVKAKARSAQLYIDIRGSMTPCKVVPMPFYRR
Specific function: The glycine cleavage system catalyzes the degradation of glycine [H]
COG id: COG0404
COG function: function code E; Glycine cleavage system T protein (aminomethyltransferase)
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the gcvT family [H]
Homologues:
Organism=Homo sapiens, GI44662838, Length=381, Percent_Identity=30.9711286089239, Blast_Score=147, Evalue=1e-35, Organism=Homo sapiens, GI257796258, Length=352, Percent_Identity=31.8181818181818, Blast_Score=143, Evalue=3e-34, Organism=Homo sapiens, GI257796256, Length=313, Percent_Identity=30.0319488817891, Blast_Score=107, Evalue=1e-23, Organism=Homo sapiens, GI257796254, Length=376, Percent_Identity=26.8617021276596, Blast_Score=104, Evalue=1e-22, Organism=Homo sapiens, GI197927446, Length=255, Percent_Identity=24.7058823529412, Blast_Score=86, Evalue=5e-17, Organism=Homo sapiens, GI21361378, Length=255, Percent_Identity=24.7058823529412, Blast_Score=86, Evalue=5e-17, Organism=Homo sapiens, GI24797151, Length=339, Percent_Identity=23.8938053097345, Blast_Score=80, Evalue=4e-15, Organism=Escherichia coli, GI1789272, Length=368, Percent_Identity=34.5108695652174, Blast_Score=189, Evalue=3e-49, Organism=Caenorhabditis elegans, GI17560118, Length=382, Percent_Identity=30.3664921465969, Blast_Score=139, Evalue=2e-33, Organism=Caenorhabditis elegans, GI32563613, Length=405, Percent_Identity=22.2222222222222, Blast_Score=84, Evalue=1e-16, Organism=Saccharomyces cerevisiae, GI6320222, Length=376, Percent_Identity=30.8510638297872, Blast_Score=160, Evalue=3e-40, Organism=Drosophila melanogaster, GI20129441, Length=376, Percent_Identity=32.4468085106383, Blast_Score=155, Evalue=5e-38, Organism=Drosophila melanogaster, GI20130091, Length=248, Percent_Identity=24.5967741935484, Blast_Score=71, Evalue=1e-12, Organism=Drosophila melanogaster, GI28571104, Length=293, Percent_Identity=23.2081911262799, Blast_Score=68, Evalue=1e-11,
Paralogues:
None
Copy number: 40 Molecules/Cell In: Stationary Phase, Rich Media (Based on E. coli). [C]
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR013977 - InterPro: IPR006222 - InterPro: IPR006223 - InterPro: IPR022903 [H]
Pfam domain/function: PF01571 GCV_T; PF08669 GCV_T_C [H]
EC number: =2.1.2.10 [H]
Molecular weight: Translated: 39134; Mature: 39003
Theoretical pI: Translated: 7.22; Mature: 7.22
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
3.1 %Cys (Translated Protein) 2.5 %Met (Translated Protein) 5.6 %Cys+Met (Translated Protein) 3.1 %Cys (Mature Protein) 2.3 %Met (Mature Protein) 5.4 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MAMTRVSPLDNEHKALGAIFTCFAGYKLPVRYKSDIAEHTAVRQGCGIFDLSHMAEIFVS CCCCCCCCCCCHHHHHHHHHHHHCCCEEEEEHHHHHHHHHHHHHCCCEECHHHHHHHHHH GVNAGLELDIALTGHFSDMTCGRAKYTLILNEQGGIEDDLIVYRIDDKNYMVVANAINRK CCCCCEEEEEEEEECCCCCCCCCEEEEEEECCCCCCCCCEEEEEECCCCEEEEEECCCHH KVFSLLRDRVHTSDIKDETDSISLVAVQGPESESLIRDLFHESGNLRYFSHRCYPHGGTD HHHHHHHHHHHCCCCCCCCCCEEEEEEECCCHHHHHHHHHHCCCCEEEEEEEECCCCCCC RSEKLSCSIVARTGYTGEDGFEIFTPNDSVVSIWRALIERGATPCGLAARNTLRIEAGMP CCCEEEEEEEEECCCCCCCCCEEECCCCHHHHHHHHHHHCCCCCCCCCCCCEEEEECCCC LYGHELRADLNPVQAGLERFISPPCIGCDRINHSGDFPLLVGLSIDGRRAAREGYTIYSS CCCHHHHCCCCHHHHHHHHHCCCCCCCCCCCCCCCCCCEEEEEECCCCHHHCCCEEEEEC SNIPVGTVTSGCFSPTLGCSIAMAYVKAKARSAQLYIDIRGSMTPCKVVPMPFYRR CCCCEEECCCCCCCCCHHHHHHHHHHHHHCCCEEEEEEECCCCCCCEEECCCCCCC >Mature Secondary Structure AMTRVSPLDNEHKALGAIFTCFAGYKLPVRYKSDIAEHTAVRQGCGIFDLSHMAEIFVS CCCCCCCCCCHHHHHHHHHHHHCCCEEEEEHHHHHHHHHHHHHCCCEECHHHHHHHHHH GVNAGLELDIALTGHFSDMTCGRAKYTLILNEQGGIEDDLIVYRIDDKNYMVVANAINRK CCCCCEEEEEEEEECCCCCCCCCEEEEEEECCCCCCCCCEEEEEECCCCEEEEEECCCHH KVFSLLRDRVHTSDIKDETDSISLVAVQGPESESLIRDLFHESGNLRYFSHRCYPHGGTD HHHHHHHHHHHCCCCCCCCCCEEEEEEECCCHHHHHHHHHHCCCCEEEEEEEECCCCCCC RSEKLSCSIVARTGYTGEDGFEIFTPNDSVVSIWRALIERGATPCGLAARNTLRIEAGMP CCCEEEEEEEEECCCCCCCCCEEECCCCHHHHHHHHHHHCCCCCCCCCCCCEEEEECCCC LYGHELRADLNPVQAGLERFISPPCIGCDRINHSGDFPLLVGLSIDGRRAAREGYTIYSS CCCHHHHCCCCHHHHHHHHHCCCCCCCCCCCCCCCCCCEEEEEECCCCHHHCCCEEEEEC SNIPVGTVTSGCFSPTLGCSIAMAYVKAKARSAQLYIDIRGSMTPCKVVPMPFYRR CCCCEEECCCCCCCCCHHHHHHHHHHHHHCCCEEEEEEECCCCCCCEEECCCCCCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 10.0
TargetDB status: NA
Availability: NA
References: NA