Definition Bacillus clausii KSM-K16, complete genome.
Accession NC_006582
Length 4,303,871

Click here to switch to the map view.

The map label for this gene is pucG [H]

Identifier: 56965499

GI number: 56965499

Start: 3897503

End: 3898744

Strand: Direct

Name: pucG [H]

Synonym: ABC3739

Alternate gene names: 56965499

Gene position: 3897503-3898744 (Clockwise)

Preceding gene: 56965498

Following gene: 56965514

Centisome position: 90.56

GC content: 51.13

Gene sequence:

>1242_bases
ATGGATACGTACCTTTCAGCAAAGCGGACGATTATGACGCCAGGGCCGGTAGAAGTCGACCCCCGTGTCTTGCAGGCAAT
GAGCATGCCGATTCTAGGGCAATTTGACCCTGCTTTTACGAACATCATGAATCAGACGATGGACCAACTGCGCAAGTTGT
TCCAAACAGAAAACGAGTGGGCCTATCCCGTTGACGGGACGTCACGTTCAGGGATTGAGGCTGTTCTCGCCAGTTTAATT
GAACGAGGAGACCGTGTGCTTGTGCCGATTTACGGACGTTTCGGCCATTTGCTTGTAGAAATTTGCGAACGTTACGGGGC
CGATGTCCACAAAATCGAATGTACGTGGGGCACTGTGTTTAGCGAAGAAGAAGTAATCAACCACATCCACGCAATCAAGC
CTAACATTGTCGCGTGTGTCCATGGGGAAACGTCAACTGGATGCATGCAACCACTCGCCCAAATCGGCAAAGCTTGCCGT
GAACAAGGTTGCCTGTTTGTTGTTGATGCGGTTGCTACGATTGGGGGAACCGACGTTTTAGTCGATGAATGGCACATTGA
TGCTGCTATTGGCGGCACGCAAAAATGCTTGTCCGTCCCGGCTGGCATGGCACCGATTACGTACAATCAACGAGTGGAAG
AAGTGATTGCCCGCCGCAAAAAAGTCGAACAAGGAATTGCAACCAAAGACGACTTGGACGAACCACTGCGAGGGACAGTT
GTCGCCAGCAACTATTTTGACCTTGGCATGCTGCAGGATTACTGGAGTCCAAGGCGTTTGAACCACCATACGGAAGCAAC
CTCCATGGTGTATGCTCTCCATAAAGGGTTAGCGATTCTTCTGGAAGAAGGGCTCCCCCACCGGTTTGCGCGACACGCGT
ACCATGAAAAAGCGCTTATTGCCGGTCTAACAGCAATGGGGCTTGAGTTATTTGTCTCCCATCAGCACAAATTGCCGATG
GTGACGTGCGTGTGCGTACCTGTTGGGCTTGACGCTGATCGCGTGCGTGCCTTTATGTTGCACCATTTTGGCGTAGAGAT
CGCTAGCTCTTTCGGACCGCTCTATGGGAAAATCTGGCGGATTGGCACAATGGGCTATAGCTGTCGCAAGGAAAACATTT
TGTTTGTGCTCGCAGCACTTGAGGCAGCGCTTCTCCATTACGGTACAAAGATTGAAACCGGTAAAGCCGTCCAAGCGGCG
CTTTCCTACTACGAACAAACAGAAAAGTCCGCAATGGCCTAA

Upstream 100 bases:

>100_bases
CGATGAAGATTTGGAAGCTGGCGTATCTGCACTTGCCGCCCTTTTGTATAAGCTTGCCTATTAGTTTAAAGCTGCAAAAT
GTTTTTGAAGGAGAATTGCA

Downstream 100 bases:

>100_bases
ACAGCGAGTTGGCCAAGGCGCTGTCAGCCGCTTGGCACCCGTATGGGGAGAGCGAATTCACCATTTGACCGAGCTCCTCT
CTGCAAAGACGATGCCGAAT

Product: aminotransferase

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 413; Mature: 413

Protein sequence:

>413_residues
MDTYLSAKRTIMTPGPVEVDPRVLQAMSMPILGQFDPAFTNIMNQTMDQLRKLFQTENEWAYPVDGTSRSGIEAVLASLI
ERGDRVLVPIYGRFGHLLVEICERYGADVHKIECTWGTVFSEEEVINHIHAIKPNIVACVHGETSTGCMQPLAQIGKACR
EQGCLFVVDAVATIGGTDVLVDEWHIDAAIGGTQKCLSVPAGMAPITYNQRVEEVIARRKKVEQGIATKDDLDEPLRGTV
VASNYFDLGMLQDYWSPRRLNHHTEATSMVYALHKGLAILLEEGLPHRFARHAYHEKALIAGLTAMGLELFVSHQHKLPM
VTCVCVPVGLDADRVRAFMLHHFGVEIASSFGPLYGKIWRIGTMGYSCRKENILFVLAALEAALLHYGTKIETGKAVQAA
LSYYEQTEKSAMA

Sequences:

>Translated_413_residues
MDTYLSAKRTIMTPGPVEVDPRVLQAMSMPILGQFDPAFTNIMNQTMDQLRKLFQTENEWAYPVDGTSRSGIEAVLASLI
ERGDRVLVPIYGRFGHLLVEICERYGADVHKIECTWGTVFSEEEVINHIHAIKPNIVACVHGETSTGCMQPLAQIGKACR
EQGCLFVVDAVATIGGTDVLVDEWHIDAAIGGTQKCLSVPAGMAPITYNQRVEEVIARRKKVEQGIATKDDLDEPLRGTV
VASNYFDLGMLQDYWSPRRLNHHTEATSMVYALHKGLAILLEEGLPHRFARHAYHEKALIAGLTAMGLELFVSHQHKLPM
VTCVCVPVGLDADRVRAFMLHHFGVEIASSFGPLYGKIWRIGTMGYSCRKENILFVLAALEAALLHYGTKIETGKAVQAA
LSYYEQTEKSAMA
>Mature_413_residues
MDTYLSAKRTIMTPGPVEVDPRVLQAMSMPILGQFDPAFTNIMNQTMDQLRKLFQTENEWAYPVDGTSRSGIEAVLASLI
ERGDRVLVPIYGRFGHLLVEICERYGADVHKIECTWGTVFSEEEVINHIHAIKPNIVACVHGETSTGCMQPLAQIGKACR
EQGCLFVVDAVATIGGTDVLVDEWHIDAAIGGTQKCLSVPAGMAPITYNQRVEEVIARRKKVEQGIATKDDLDEPLRGTV
VASNYFDLGMLQDYWSPRRLNHHTEATSMVYALHKGLAILLEEGLPHRFARHAYHEKALIAGLTAMGLELFVSHQHKLPM
VTCVCVPVGLDADRVRAFMLHHFGVEIASSFGPLYGKIWRIGTMGYSCRKENILFVLAALEAALLHYGTKIETGKAVQAA
LSYYEQTEKSAMA

Specific function: Could encode ureidoglycolase or L-alanine:glyoxylate aminotransferase, or perhaps both activities [H]

COG id: COG0075

COG function: function code E; Serine-pyruvate aminotransferase/archaeal aspartate aminotransferase

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Belongs to the class-V pyridoxal-phosphate-dependent aminotransferase family [H]

Homologues:

Organism=Homo sapiens, GI4557289, Length=383, Percent_Identity=32.6370757180157, Blast_Score=216, Evalue=3e-56,
Organism=Caenorhabditis elegans, GI17536281, Length=377, Percent_Identity=36.604774535809, Blast_Score=232, Evalue=2e-61,
Organism=Saccharomyces cerevisiae, GI6321079, Length=386, Percent_Identity=24.3523316062176, Blast_Score=91, Evalue=3e-19,
Organism=Drosophila melanogaster, GI17530823, Length=390, Percent_Identity=35.6410256410256, Blast_Score=250, Evalue=1e-66,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR000192
- InterPro:   IPR020578
- InterPro:   IPR015424
- InterPro:   IPR015421
- InterPro:   IPR015422 [H]

Pfam domain/function: PF00266 Aminotran_5 [H]

EC number: NA

Molecular weight: Translated: 45699; Mature: 45699

Theoretical pI: Translated: 6.46; Mature: 6.46

Prosite motif: PS00595 AA_TRANSFER_CLASS_5

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

2.4 %Cys     (Translated Protein)
3.6 %Met     (Translated Protein)
6.1 %Cys+Met (Translated Protein)
2.4 %Cys     (Mature Protein)
3.6 %Met     (Mature Protein)
6.1 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MDTYLSAKRTIMTPGPVEVDPRVLQAMSMPILGQFDPAFTNIMNQTMDQLRKLFQTENEW
CCCCCCCCCEEECCCCCCCCHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHHCCCCCE
AYPVDGTSRSGIEAVLASLIERGDRVLVPIYGRFGHLLVEICERYGADVHKIECTWGTVF
ECCCCCCCCCCHHHHHHHHHHCCCEEEEECHHHHHHHHHHHHHHHCCCEEEEEEEECCCC
SEEEVINHIHAIKPNIVACVHGETSTGCMQPLAQIGKACREQGCLFVVDAVATIGGTDVL
CHHHHHHHHHHCCCCEEEEECCCCCHHHHHHHHHHHHHHHHCCCEEEEEHHHHCCCCEEE
VDEWHIDAAIGGTQKCLSVPAGMAPITYNQRVEEVIARRKKVEQGIATKDDLDEPLRGTV
EEEEEECHHCCCHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCEE
VASNYFDLGMLQDYWSPRRLNHHTEATSMVYALHKGLAILLEEGLPHRFARHAYHEKALI
EECCCCCHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHH
AGLTAMGLELFVSHQHKLPMVTCVCVPVGLDADRVRAFMLHHFGVEIASSFGPLYGKIWR
HHHHHHHHHHHHHCCCCCCEEEEEEEECCCCHHHHHHHHHHHHHHHHHHHCCHHHHHHHH
IGTMGYSCRKENILFVLAALEAALLHYGTKIETGKAVQAALSYYEQTEKSAMA
EECCCCCCCCCCHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHCCC
>Mature Secondary Structure
MDTYLSAKRTIMTPGPVEVDPRVLQAMSMPILGQFDPAFTNIMNQTMDQLRKLFQTENEW
CCCCCCCCCEEECCCCCCCCHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHHCCCCCE
AYPVDGTSRSGIEAVLASLIERGDRVLVPIYGRFGHLLVEICERYGADVHKIECTWGTVF
ECCCCCCCCCCHHHHHHHHHHCCCEEEEECHHHHHHHHHHHHHHHCCCEEEEEEEECCCC
SEEEVINHIHAIKPNIVACVHGETSTGCMQPLAQIGKACREQGCLFVVDAVATIGGTDVL
CHHHHHHHHHHCCCCEEEEECCCCCHHHHHHHHHHHHHHHHCCCEEEEEHHHHCCCCEEE
VDEWHIDAAIGGTQKCLSVPAGMAPITYNQRVEEVIARRKKVEQGIATKDDLDEPLRGTV
EEEEEECHHCCCHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCEE
VASNYFDLGMLQDYWSPRRLNHHTEATSMVYALHKGLAILLEEGLPHRFARHAYHEKALI
EECCCCCHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHH
AGLTAMGLELFVSHQHKLPMVTCVCVPVGLDADRVRAFMLHHFGVEIASSFGPLYGKIWR
HHHHHHHHHHHHHCCCCCCEEEEEEEECCCCHHHHHHHHHHHHHHHHHHHCCHHHHHHHH
IGTMGYSCRKENILFVLAALEAALLHYGTKIETGKAVQAALSYYEQTEKSAMA
EECCCCCCCCCCHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 9384377; 11344136 [H]