Definition Prochlorococcus marinus str. MIT 9312, complete genome.
Accession NC_007577
Length 1,709,204

Click here to switch to the map view.

The map label for this gene is pucG [H]

Identifier: 78779265

GI number: 78779265

Start: 813349

End: 814533

Strand: Direct

Name: pucG [H]

Synonym: PMT9312_0881

Alternate gene names: 78779265

Gene position: 813349-814533 (Clockwise)

Preceding gene: 78779261

Following gene: 78779267

Centisome position: 47.59

GC content: 34.6

Gene sequence:

>1185_bases
TTGACAGAGGCAAAACTTATTTCTGCTTTAAATGAAGAGAATTTATCTCATTTCTCAAAGACTTATGTTCCCTCTAGACT
TTTATTAGGTCCTGGTCCTTCAAACGCACATCCAGAAGTTTTAAACGCTCTTTCCCTAAATCCAATCGGTCATTTAGATG
AAGCATATATTTCATTAATGTCTGATGTTCAAAAACTTCTACGATATACCTGGCAATGCAATAATCGTCTTACTCTCCCA
ATGAGTGGTACTGGAAGTGCAGCTATGGAAGCTTCAATAGCGAATTTTATAGAGGAAGGAGAAACAATTCTTATCGCTAA
AAAAGGATATTTTGGAGACAGACTTGTTGATATGGCTACTAGATATAAAGCAGAAGTATCTGTTATGGAAAAACCTTGGG
GTGAATCTTTTTCTTATGAAGAAATCAAGTATGAAATAGAGACTAAAAAACCAGCTATATTTGCTATTGTTCATGCTGAA
ACCTCTAGTGGGGTTTTACAACCTCTTGATGGAATTGGTGATGTATGTAGAAAAAATAACTCCTTGTTTTTAGTTGACGC
AGTTACTTCCCTTGGCGCTTTAGAACTATTGATAGATGAATGGAAAATAGATTTAGCGTATAGTTGTAGCCAGAAAGGAT
TAAGTTGCCCGCCTGGATTAAGTCCTTTTACAATGAATGAGAGAGCTGAAGAAAAACTAAGTTCAAGAAAAACAAAAGTC
CCTAACTGGTATTTAGATTTATCTCTTTTAAATAAATATTGGGGTTCAGATCGTGTTTACCATCATACCGCCCCTGTAAA
TATGAATTTTGCTATTAGAGAGGGTTTACGATTAATTGCAAATGAAGGTTTAGAGAATGTTTGGAATAGGCATAATACTA
ATGCAAGGAAACTGTGGAATGGTTTAGAAAGTTTAGGCATGGAATTACATGTATCAAAGGATTATCGATTGCCAACTCTT
ACAACAGTTAAGATTCCACCAGCAGTTGATGGAGATGGTTTTAGAAATCATCTTTTAAGAAACTTTGGAATAGAAATAGG
AAATGGACTTGGAGAATTGTCAGGTAAGGTATGGCGTATAGGATTAATGGGCTTTAACTCAAGTGAAGAGAATGTCGACA
GATTATTAAACCTATTTGATACTGAGTTAAAGAAATATTCTATTTTTGAGTCCTCAACTTTTTAA

Upstream 100 bases:

>100_bases
TAATTGTTTACCTAAATATTTAAATTGAATGAATTTCTTTAAATAAATCTCGCTTATGTGGCGATATTAGTTTAATTTAA
AAGTAATTGAATGTAATGCT

Downstream 100 bases:

>100_bases
ACCATAATTGTAAAATTTGACTGCATTCTTCTTCTAAGATACCCCCTACAATTTCCATCTTGTGATGAGAACTTTTATGC
TTTGATAAGTCAATTGATCC

Product: serine:pyruvate/alanine:glyoxylate aminotransferase

Products: pyruvate; glycine

Alternate protein names: NA

Number of amino acids: Translated: 394; Mature: 393

Protein sequence:

>394_residues
MTEAKLISALNEENLSHFSKTYVPSRLLLGPGPSNAHPEVLNALSLNPIGHLDEAYISLMSDVQKLLRYTWQCNNRLTLP
MSGTGSAAMEASIANFIEEGETILIAKKGYFGDRLVDMATRYKAEVSVMEKPWGESFSYEEIKYEIETKKPAIFAIVHAE
TSSGVLQPLDGIGDVCRKNNSLFLVDAVTSLGALELLIDEWKIDLAYSCSQKGLSCPPGLSPFTMNERAEEKLSSRKTKV
PNWYLDLSLLNKYWGSDRVYHHTAPVNMNFAIREGLRLIANEGLENVWNRHNTNARKLWNGLESLGMELHVSKDYRLPTL
TTVKIPPAVDGDGFRNHLLRNFGIEIGNGLGELSGKVWRIGLMGFNSSEENVDRLLNLFDTELKKYSIFESSTF

Sequences:

>Translated_394_residues
MTEAKLISALNEENLSHFSKTYVPSRLLLGPGPSNAHPEVLNALSLNPIGHLDEAYISLMSDVQKLLRYTWQCNNRLTLP
MSGTGSAAMEASIANFIEEGETILIAKKGYFGDRLVDMATRYKAEVSVMEKPWGESFSYEEIKYEIETKKPAIFAIVHAE
TSSGVLQPLDGIGDVCRKNNSLFLVDAVTSLGALELLIDEWKIDLAYSCSQKGLSCPPGLSPFTMNERAEEKLSSRKTKV
PNWYLDLSLLNKYWGSDRVYHHTAPVNMNFAIREGLRLIANEGLENVWNRHNTNARKLWNGLESLGMELHVSKDYRLPTL
TTVKIPPAVDGDGFRNHLLRNFGIEIGNGLGELSGKVWRIGLMGFNSSEENVDRLLNLFDTELKKYSIFESSTF
>Mature_393_residues
TEAKLISALNEENLSHFSKTYVPSRLLLGPGPSNAHPEVLNALSLNPIGHLDEAYISLMSDVQKLLRYTWQCNNRLTLPM
SGTGSAAMEASIANFIEEGETILIAKKGYFGDRLVDMATRYKAEVSVMEKPWGESFSYEEIKYEIETKKPAIFAIVHAET
SSGVLQPLDGIGDVCRKNNSLFLVDAVTSLGALELLIDEWKIDLAYSCSQKGLSCPPGLSPFTMNERAEEKLSSRKTKVP
NWYLDLSLLNKYWGSDRVYHHTAPVNMNFAIREGLRLIANEGLENVWNRHNTNARKLWNGLESLGMELHVSKDYRLPTLT
TVKIPPAVDGDGFRNHLLRNFGIEIGNGLGELSGKVWRIGLMGFNSSEENVDRLLNLFDTELKKYSIFESSTF

Specific function: Could encode ureidoglycolase or L-alanine:glyoxylate aminotransferase, or perhaps both activities [H]

COG id: COG0075

COG function: function code E; Serine-pyruvate aminotransferase/archaeal aspartate aminotransferase

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the class-V pyridoxal-phosphate-dependent aminotransferase family [H]

Homologues:

Organism=Homo sapiens, GI4557289, Length=367, Percent_Identity=41.9618528610354, Blast_Score=300, Evalue=1e-81,
Organism=Caenorhabditis elegans, GI17536281, Length=369, Percent_Identity=39.2953929539295, Blast_Score=294, Evalue=6e-80,
Organism=Saccharomyces cerevisiae, GI6321079, Length=373, Percent_Identity=27.0777479892761, Blast_Score=122, Evalue=1e-28,
Organism=Drosophila melanogaster, GI17530823, Length=368, Percent_Identity=39.4021739130435, Blast_Score=300, Evalue=1e-81,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR000192
- InterPro:   IPR020578
- InterPro:   IPR015424
- InterPro:   IPR015421
- InterPro:   IPR015422 [H]

Pfam domain/function: PF00266 Aminotran_5 [H]

EC number: 2.6.1.44

Molecular weight: Translated: 44127; Mature: 43996

Theoretical pI: Translated: 5.87; Mature: 5.87

Prosite motif: PS00595 AA_TRANSFER_CLASS_5

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.0 %Cys     (Translated Protein)
2.5 %Met     (Translated Protein)
3.6 %Cys+Met (Translated Protein)
1.0 %Cys     (Mature Protein)
2.3 %Met     (Mature Protein)
3.3 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MTEAKLISALNEENLSHFSKTYVPSRLLLGPGPSNAHPEVLNALSLNPIGHLDEAYISLM
CCHHHHHHHHHHHHHHHHHHHCCCCEEEECCCCCCCCHHHHHHHCCCCCCCHHHHHHHHH
SDVQKLLRYTWQCNNRLTLPMSGTGSAAMEASIANFIEEGETILIAKKGYFGDRLVDMAT
HHHHHHHHHHHHCCCEEEEEECCCCCHHHHHHHHHHHHCCCEEEEEECCCCCHHHHHHHH
RYKAEVSVMEKPWGESFSYEEIKYEIETKKPAIFAIVHAETSSGVLQPLDGIGDVCRKNN
HHHHHHHHHCCCCCCCCCHHHEEEEEECCCCEEEEEEEECCCCCCCCCHHHHHHHHHCCC
SLFLVDAVTSLGALELLIDEWKIDLAYSCSQKGLSCPPGLSPFTMNERAEEKLSSRKTKV
CEEEEECHHHHHHHHHHHHHHCEEEEEECCCCCCCCCCCCCCCCCCHHHHHHHHHCCCCC
PNWYLDLSLLNKYWGSDRVYHHTAPVNMNFAIREGLRLIANEGLENVWNRHNTNARKLWN
CCEEEEHHHHHHHCCCCCEEEECCCCCCCHHHHHHHHHHHHCCHHHHHHCCCCCHHHHHH
GLESLGMELHVSKDYRLPTLTTVKIPPAVDGDGFRNHLLRNFGIEIGNGLGELSGKVWRI
HHHHCCEEEEECCCCCCCEEEEEECCCCCCCCHHHHHHHHHCCCHHCCCHHHCCCCEEEE
GLMGFNSSEENVDRLLNLFDTELKKYSIFESSTF
EEEECCCCHHHHHHHHHHHHHHHHHEECCCCCCC
>Mature Secondary Structure 
TEAKLISALNEENLSHFSKTYVPSRLLLGPGPSNAHPEVLNALSLNPIGHLDEAYISLM
CHHHHHHHHHHHHHHHHHHHCCCCEEEECCCCCCCCHHHHHHHCCCCCCCHHHHHHHHH
SDVQKLLRYTWQCNNRLTLPMSGTGSAAMEASIANFIEEGETILIAKKGYFGDRLVDMAT
HHHHHHHHHHHHCCCEEEEEECCCCCHHHHHHHHHHHHCCCEEEEEECCCCCHHHHHHHH
RYKAEVSVMEKPWGESFSYEEIKYEIETKKPAIFAIVHAETSSGVLQPLDGIGDVCRKNN
HHHHHHHHHCCCCCCCCCHHHEEEEEECCCCEEEEEEEECCCCCCCCCHHHHHHHHHCCC
SLFLVDAVTSLGALELLIDEWKIDLAYSCSQKGLSCPPGLSPFTMNERAEEKLSSRKTKV
CEEEEECHHHHHHHHHHHHHHCEEEEEECCCCCCCCCCCCCCCCCCHHHHHHHHHCCCCC
PNWYLDLSLLNKYWGSDRVYHHTAPVNMNFAIREGLRLIANEGLENVWNRHNTNARKLWN
CCEEEEHHHHHHHCCCCCEEEECCCCCCCHHHHHHHHHHHHCCHHHHHHCCCCCHHHHHH
GLESLGMELHVSKDYRLPTLTTVKIPPAVDGDGFRNHLLRNFGIEIGNGLGELSGKVWRI
HHHHCCEEEEECCCCCCCEEEEEECCCCCCCCHHHHHHHHHCCCHHCCCHHHCCCCEEEE
GLMGFNSSEENVDRLLNLFDTELKKYSIFESSTF
EEEECCCCHHHHHHHHHHHHHHHHHEECCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: L-alanine; glyoxylate

Specific reaction: L-alanine + glyoxylate = pyruvate + glycine

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 9384377; 11344136 [H]