Definition Nitrosomonas eutropha C91, complete genome.
Accession NC_008344
Length 2,661,057

Click here to switch to the map view.

The map label for this gene is gcvPB

Identifier: 114331925

GI number: 114331925

Start: 2065465

End: 2066916

Strand: Reverse

Name: gcvPB

Synonym: Neut_1952

Alternate gene names: 114331925

Gene position: 2066916-2065465 (Counterclockwise)

Preceding gene: 114331926

Following gene: 114331924

Centisome position: 77.67

GC content: 51.38

Gene sequence:

>1452_bases
ATGCTGATATTTGAACATTCCCGCAAAAATCGCCTGAATTATTCCCAGGCTCCGGCAACCCGGCCAGCCAAGAACAATAT
TCCGGATAATCTGAAGCGCAAATCGGCTCCCTTGTTGCCTGAGGTTTCCGAAATGGATACGGTGCGTCACTATACTCGGC
TATCCCAGAAAAATTTCTCGATAGATACGGAGTTTTACCCACTTGGTTCCTGCACCATGAAATACAACCCGCGTGCCTGT
AATGCACTGGCCATGTTGCCACAATTTTTATCACGCCACCCGCTGGCGCCAGAAGATACGGGTCAAGGCTTCTTGGCTTG
TATGTATGAGCTGCAGGAAATCCTGAAAGACGTTACGGGTATGTCTGCGGTTAGCCTGACTTCCATGGCGGGTGCACAGG
GCGAACTGATCGGTATTACGATGATTCGTGCCTATCATGAAGCGCGTGGAGATACCGAGCGCACCGAGATCATCATCCCG
GATGCTGCGCATGGTACCAACCCGGCGACCGCTGTCATGTGCGGTTATAAGGTGATCGAGATTCCTACGGATCGCGATGG
TGACGTGGATATGGAAGCCTTGAAAGCGGCAGTTAGTCCCAGAACAGCTGGTTTAATGCTGACTAACCCTTCCACTCTGG
GCGTATTCGAGAAAAAAGTGGCAGAAATGAGCCGAGTCGTGCATGAGGCCGGTGGTTTGCTGTACTACGATGGGGCCAAT
CTTAATGCAGTACTGGGTAAAGTCAAACCGGGTGACATGGGATTTGATGTGATCCACATGAATCTGCATAAAACTTTCTC
GACCCCTCATGGCGGTGGTGGGCCGGGTGCGGCTCCGGTAGGCGTGGCAGACTGTTTGTTGCCTTATTTGCCGATCCCTA
TCGTGGCGCATGAACAGGGTGTTTATCGCTGGTTGACGGAGAAAGATCGTCCTCAATCTATCGGACGCTTATCCGCGCAC
ATGGGTAATGCAGGAGTACTGTTGCGTGCTTACATCTATGTCAGATTGCTGGGTGCAGAAGGAATGTTCCGGATTGCAGA
ATATGCAACACTCAATGCTAATTATCTGCTGGCCGAGTTACGCAAACTGGGCTTTGAGATTGCCTATCCCAGCCGGCGAG
CCAGTCACGAATTCATTGTCACTATGAAGGAAATCAAGGATAAAACCGGAGTGACTGCAATGCACCTGGCCAAGCGCCTG
CTGGACAAGGGTTTTCACGCGCCAACCGTCTATTTTCCGCTGCTGGTGCCGGAATGTTTGCTGATCGAGCCGGCTGAAAC
CGAATCCAAAGAAACGCTGGATCGCTTTGTTGTTGCGATGAAGGAGATTCTGGATGAGATAGACACGCAACCGGAAATGG
TCAAGACGGCGCCTCATAACATGCCGTTGCGGAAAATAGATGATGTCAAGGCTGCTCGTGAACTTGATCTGGTATGGAAT
CCAGCGGGCTGA

Upstream 100 bases:

>100_bases
TGTTGCGGCAGATACTGAAAGCCTGAAATCAGGAGTAAACCGGAAGAGAGCCGCGTTACTTGTTCTGTATTGAATCAATC
TCACCAACCTAAGATAAAAC

Downstream 100 bases:

>100_bases
TTCACCTCATGCACACGATATTTGAGCTGATATGCATACACTGATCTGTGGCTCCATCGCCTATGACACAATCATGGTGT
TTGAAGACCGTTTCAAACGC

Product: glycine dehydrogenase subunit 2

Products: NA

Alternate protein names: Glycine cleavage system P-protein subunit 2; Glycine decarboxylase subunit 2

Number of amino acids: Translated: 483; Mature: 483

Protein sequence:

>483_residues
MLIFEHSRKNRLNYSQAPATRPAKNNIPDNLKRKSAPLLPEVSEMDTVRHYTRLSQKNFSIDTEFYPLGSCTMKYNPRAC
NALAMLPQFLSRHPLAPEDTGQGFLACMYELQEILKDVTGMSAVSLTSMAGAQGELIGITMIRAYHEARGDTERTEIIIP
DAAHGTNPATAVMCGYKVIEIPTDRDGDVDMEALKAAVSPRTAGLMLTNPSTLGVFEKKVAEMSRVVHEAGGLLYYDGAN
LNAVLGKVKPGDMGFDVIHMNLHKTFSTPHGGGGPGAAPVGVADCLLPYLPIPIVAHEQGVYRWLTEKDRPQSIGRLSAH
MGNAGVLLRAYIYVRLLGAEGMFRIAEYATLNANYLLAELRKLGFEIAYPSRRASHEFIVTMKEIKDKTGVTAMHLAKRL
LDKGFHAPTVYFPLLVPECLLIEPAETESKETLDRFVVAMKEILDEIDTQPEMVKTAPHNMPLRKIDDVKAARELDLVWN
PAG

Sequences:

>Translated_483_residues
MLIFEHSRKNRLNYSQAPATRPAKNNIPDNLKRKSAPLLPEVSEMDTVRHYTRLSQKNFSIDTEFYPLGSCTMKYNPRAC
NALAMLPQFLSRHPLAPEDTGQGFLACMYELQEILKDVTGMSAVSLTSMAGAQGELIGITMIRAYHEARGDTERTEIIIP
DAAHGTNPATAVMCGYKVIEIPTDRDGDVDMEALKAAVSPRTAGLMLTNPSTLGVFEKKVAEMSRVVHEAGGLLYYDGAN
LNAVLGKVKPGDMGFDVIHMNLHKTFSTPHGGGGPGAAPVGVADCLLPYLPIPIVAHEQGVYRWLTEKDRPQSIGRLSAH
MGNAGVLLRAYIYVRLLGAEGMFRIAEYATLNANYLLAELRKLGFEIAYPSRRASHEFIVTMKEIKDKTGVTAMHLAKRL
LDKGFHAPTVYFPLLVPECLLIEPAETESKETLDRFVVAMKEILDEIDTQPEMVKTAPHNMPLRKIDDVKAARELDLVWN
PAG
>Mature_483_residues
MLIFEHSRKNRLNYSQAPATRPAKNNIPDNLKRKSAPLLPEVSEMDTVRHYTRLSQKNFSIDTEFYPLGSCTMKYNPRAC
NALAMLPQFLSRHPLAPEDTGQGFLACMYELQEILKDVTGMSAVSLTSMAGAQGELIGITMIRAYHEARGDTERTEIIIP
DAAHGTNPATAVMCGYKVIEIPTDRDGDVDMEALKAAVSPRTAGLMLTNPSTLGVFEKKVAEMSRVVHEAGGLLYYDGAN
LNAVLGKVKPGDMGFDVIHMNLHKTFSTPHGGGGPGAAPVGVADCLLPYLPIPIVAHEQGVYRWLTEKDRPQSIGRLSAH
MGNAGVLLRAYIYVRLLGAEGMFRIAEYATLNANYLLAELRKLGFEIAYPSRRASHEFIVTMKEIKDKTGVTAMHLAKRL
LDKGFHAPTVYFPLLVPECLLIEPAETESKETLDRFVVAMKEILDEIDTQPEMVKTAPHNMPLRKIDDVKAARELDLVWN
PAG

Specific function: The glycine cleavage system catalyzes the degradation of glycine. The P protein binds the alpha-amino group of glycine through its pyridoxal phosphate cofactor; CO(2) is released and the remaining methylamine moiety is then transferred to the lipoamide co

COG id: COG1003

COG function: function code E; Glycine cleavage system protein P (pyridoxal-binding), C-terminal domain

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the gcvP family. C-terminal subunit subfamily

Homologues:

Organism=Homo sapiens, GI108773801, Length=456, Percent_Identity=38.3771929824561, Blast_Score=274, Evalue=1e-73,
Organism=Escherichia coli, GI1789269, Length=412, Percent_Identity=41.2621359223301, Blast_Score=287, Evalue=1e-78,
Organism=Caenorhabditis elegans, GI17535605, Length=433, Percent_Identity=39.4919168591224, Blast_Score=261, Evalue=5e-70,
Organism=Caenorhabditis elegans, GI32564013, Length=390, Percent_Identity=39.2307692307692, Blast_Score=235, Evalue=4e-62,
Organism=Saccharomyces cerevisiae, GI6323843, Length=457, Percent_Identity=40.9190371991247, Blast_Score=300, Evalue=4e-82,
Organism=Drosophila melanogaster, GI24645648, Length=438, Percent_Identity=40.8675799086758, Blast_Score=278, Evalue=6e-75,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): GCSPB_NITEC (Q0AEQ0)

Other databases:

- EMBL:   CP000450
- RefSeq:   YP_748147.1
- ProteinModelPortal:   Q0AEQ0
- SMR:   Q0AEQ0
- STRING:   Q0AEQ0
- GeneID:   4273339
- GenomeReviews:   CP000450_GR
- KEGG:   net:Neut_1952
- NMPDR:   fig|335283.3.peg.1075
- eggNOG:   COG1003
- HOGENOM:   HBG288344
- OMA:   RHYTRLS
- ProtClustDB:   PRK04366
- BioCyc:   NEUT335283:NEUT_1952-MONOMER
- HAMAP:   MF_00713
- InterPro:   IPR020580
- InterPro:   IPR020581
- InterPro:   IPR023012
- InterPro:   IPR015424
- InterPro:   IPR015421
- Gene3D:   G3DSA:3.40.640.10
- PANTHER:   PTHR11773

Pfam domain/function: PF02347 GDC-P; SSF53383 PyrdxlP-dep_Trfase_major

EC number: =1.4.4.2

Molecular weight: Translated: 53271; Mature: 53271

Theoretical pI: Translated: 6.92; Mature: 6.92

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.2 %Cys     (Translated Protein)
4.3 %Met     (Translated Protein)
5.6 %Cys+Met (Translated Protein)
1.2 %Cys     (Mature Protein)
4.3 %Met     (Mature Protein)
5.6 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MLIFEHSRKNRLNYSQAPATRPAKNNIPDNLKRKSAPLLPEVSEMDTVRHYTRLSQKNFS
CEEEECCCCCCCCCCCCCCCCCCCCCCCCHHHHCCCCCCCCHHHHHHHHHHHHHHCCCCC
IDTEFYPLGSCTMKYNPRACNALAMLPQFLSRHPLAPEDTGQGFLACMYELQEILKDVTG
CCCCEEECCCEEEEECCCHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHHCC
MSAVSLTSMAGAQGELIGITMIRAYHEARGDTERTEIIIPDAAHGTNPATAVMCGYKVIE
CHHHHHHHHCCCCCCEEEHHHHHHHHHHCCCCCCEEEEECCCCCCCCCCCEEEECCEEEE
IPTDRDGDVDMEALKAAVSPRTAGLMLTNPSTLGVFEKKVAEMSRVVHEAGGLLYYDGAN
CCCCCCCCCCHHHHHHHCCCCCCEEEEECCCHHHHHHHHHHHHHHHHHHHCCEEEECCCC
LNAVLGKVKPGDMGFDVIHMNLHKTFSTPHGGGGPGAAPVGVADCLLPYLPIPIVAHEQG
CEEEEECCCCCCCCEEEEEEEEHHHCCCCCCCCCCCCCCCCHHHHHHHHCCCCEEECCCC
VYRWLTEKDRPQSIGRLSAHMGNAGVLLRAYIYVRLLGAEGMFRIAEYATLNANYLLAEL
HHHHHCCCCCHHHHHHHHHHCCCCHHHHHHHHHHHHHCCCCHHHHHHHHCCCHHHHHHHH
RKLGFEIAYPSRRASHEFIVTMKEIKDKTGVTAMHLAKRLLDKGFHAPTVYFPLLVPECL
HHCCCEEECCCCCCCCCEEEEHHHHHCCCCHHHHHHHHHHHHCCCCCCCEEHHHHCCCCE
LIEPAETESKETLDRFVVAMKEILDEIDTQPEMVKTAPHNMPLRKIDDVKAARELDLVWN
EECCCCCCHHHHHHHHHHHHHHHHHHHCCCCHHHHCCCCCCCCHHHHHHHHHHHEEEEEC
PAG
CCC
>Mature Secondary Structure
MLIFEHSRKNRLNYSQAPATRPAKNNIPDNLKRKSAPLLPEVSEMDTVRHYTRLSQKNFS
CEEEECCCCCCCCCCCCCCCCCCCCCCCCHHHHCCCCCCCCHHHHHHHHHHHHHHCCCCC
IDTEFYPLGSCTMKYNPRACNALAMLPQFLSRHPLAPEDTGQGFLACMYELQEILKDVTG
CCCCEEECCCEEEEECCCHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHHCC
MSAVSLTSMAGAQGELIGITMIRAYHEARGDTERTEIIIPDAAHGTNPATAVMCGYKVIE
CHHHHHHHHCCCCCCEEEHHHHHHHHHHCCCCCCEEEEECCCCCCCCCCCEEEECCEEEE
IPTDRDGDVDMEALKAAVSPRTAGLMLTNPSTLGVFEKKVAEMSRVVHEAGGLLYYDGAN
CCCCCCCCCCHHHHHHHCCCCCCEEEEECCCHHHHHHHHHHHHHHHHHHHCCEEEECCCC
LNAVLGKVKPGDMGFDVIHMNLHKTFSTPHGGGGPGAAPVGVADCLLPYLPIPIVAHEQG
CEEEEECCCCCCCCEEEEEEEEHHHCCCCCCCCCCCCCCCCHHHHHHHHCCCCEEECCCC
VYRWLTEKDRPQSIGRLSAHMGNAGVLLRAYIYVRLLGAEGMFRIAEYATLNANYLLAEL
HHHHHCCCCCHHHHHHHHHHCCCCHHHHHHHHHHHHHCCCCHHHHHHHHCCCHHHHHHHH
RKLGFEIAYPSRRASHEFIVTMKEIKDKTGVTAMHLAKRLLDKGFHAPTVYFPLLVPECL
HHCCCEEECCCCCCCCCEEEEHHHHHCCCCHHHHHHHHHHHHCCCCCCCEEHHHHCCCCE
LIEPAETESKETLDRFVVAMKEILDEIDTQPEMVKTAPHNMPLRKIDDVKAARELDLVWN
EECCCCCCHHHHHHHHHHHHHHHHHHHCCCCHHHHCCCCCCCCHHHHHHHHHHHEEEEEC
PAG
CCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA