Definition Psychromonas ingrahamii 37, complete genome.
Accession NC_008709
Length 4,559,598

Click here to switch to the map view.

The map label for this gene is nagZ

Identifier: 119945674

GI number: 119945674

Start: 2417660

End: 2418673

Strand: Reverse

Name: nagZ

Synonym: Ping_1987

Alternate gene names: 119945674

Gene position: 2418673-2417660 (Counterclockwise)

Preceding gene: 119945675

Following gene: 119945673

Centisome position: 53.05

GC content: 40.14

Gene sequence:

>1014_bases
ATGAGACCAGTTATCCTTGATGTTGAAGGTTATGAATTAGATTCGGAAGAGAAAGAAATTTTGGCGCACCCGTTAGTCGC
CGGTATCATACTGTTTACGCGTAATTATTATGATATCGAACAACTAAAAGCCTTAGTAAAAGATATTCGCCGGTACGCTG
GTAATGAACTTCTGATTGCCGTTGACCATGAGGGAGGGCGGGTGCAGCGATTTAGAGATGATTTTACCCGGTTACCTTCA
GCGGGTTCATTAATTGAAAAAAATGACATGAAAACGGCTTGTGAGTTAGCCTTTAGCAGCGCATGGGTAATGGCCAGTGA
ATTAATCGCCTGTGATATTGACTTCAGTTTTGCGCCTGTTTTAGATTTAAATGGTATTTCGAATGTTATCCAAAACAGAG
CATTCTCATCCTCTATAACAGAAACAGTAACGCTTGCTGAGGCGTATATTAATGGAATGAAATCTGCGGGTATGGTCTCA
ACGGGTAAACATTTCCCCGGCCATGGCAGTGTTGAAGCTGATTCTCATACGGCTTTACCAGTTGACTCGCGCAGTGAACT
TGAAATATTTACTAAAGATATTAAGCCTTTTGAAAACCTGATTAAAAAAGGGGCATTGGATGCAGTAATGCCATCACATG
TTGTTTATTCTCAATGTGACCTGCAACCTGCGGGTTTTTCATCCTATTGGCTGGATGATGTTTTGAGAACACGATTAGGG
TTCAAAGGGGTCGTTATTAGTGATGATTTATCGATGCACGGAGCCAGTTTTGTAGGTAACCATTTAAGTCGTGCAGAAAG
TGCAATACAAGCGGGATGTGATTTAATATTAGCGTGTAATGATAGAAGTGGCGCGGTTTCTATTCTTGATAATCTTAAGG
TAAAACCGACTGCTCAATACCATGCTGTTAATCAACTACGCAGTACTAAAAATAAATTTATATTACCCCTCAATAAAAAT
CCGATTTGGATAAAAAACAAGCAAATGCTAATGCAGCTCAGCGAGCAGTTCTAA

Upstream 100 bases:

>100_bases
CGCCGCTATTGCTACTTCTTTCCCATTATAGCTGCATCAAATAAGCTGCAATGCGCGGTTTTAATCTGCTCGTTGCGCAT
AAAATTTAAGAGACCCCTTT

Downstream 100 bases:

>100_bases
TTAGTGAAGTGCAATGCTTGCACTCTAGGTTAATTTCAATAAACTTATTGAATAATTAAAATAAGAAATCTGGGGGTAAT
AACATGATTATTTACATACA

Product: glycoside hydrolase family 3 protein

Products: NA

Alternate protein names: Beta-N-acetylhexosaminidase; N-acetyl-beta-glucosaminidase

Number of amino acids: Translated: 337; Mature: 337

Protein sequence:

>337_residues
MRPVILDVEGYELDSEEKEILAHPLVAGIILFTRNYYDIEQLKALVKDIRRYAGNELLIAVDHEGGRVQRFRDDFTRLPS
AGSLIEKNDMKTACELAFSSAWVMASELIACDIDFSFAPVLDLNGISNVIQNRAFSSSITETVTLAEAYINGMKSAGMVS
TGKHFPGHGSVEADSHTALPVDSRSELEIFTKDIKPFENLIKKGALDAVMPSHVVYSQCDLQPAGFSSYWLDDVLRTRLG
FKGVVISDDLSMHGASFVGNHLSRAESAIQAGCDLILACNDRSGAVSILDNLKVKPTAQYHAVNQLRSTKNKFILPLNKN
PIWIKNKQMLMQLSEQF

Sequences:

>Translated_337_residues
MRPVILDVEGYELDSEEKEILAHPLVAGIILFTRNYYDIEQLKALVKDIRRYAGNELLIAVDHEGGRVQRFRDDFTRLPS
AGSLIEKNDMKTACELAFSSAWVMASELIACDIDFSFAPVLDLNGISNVIQNRAFSSSITETVTLAEAYINGMKSAGMVS
TGKHFPGHGSVEADSHTALPVDSRSELEIFTKDIKPFENLIKKGALDAVMPSHVVYSQCDLQPAGFSSYWLDDVLRTRLG
FKGVVISDDLSMHGASFVGNHLSRAESAIQAGCDLILACNDRSGAVSILDNLKVKPTAQYHAVNQLRSTKNKFILPLNKN
PIWIKNKQMLMQLSEQF
>Mature_337_residues
MRPVILDVEGYELDSEEKEILAHPLVAGIILFTRNYYDIEQLKALVKDIRRYAGNELLIAVDHEGGRVQRFRDDFTRLPS
AGSLIEKNDMKTACELAFSSAWVMASELIACDIDFSFAPVLDLNGISNVIQNRAFSSSITETVTLAEAYINGMKSAGMVS
TGKHFPGHGSVEADSHTALPVDSRSELEIFTKDIKPFENLIKKGALDAVMPSHVVYSQCDLQPAGFSSYWLDDVLRTRLG
FKGVVISDDLSMHGASFVGNHLSRAESAIQAGCDLILACNDRSGAVSILDNLKVKPTAQYHAVNQLRSTKNKFILPLNKN
PIWIKNKQMLMQLSEQF

Specific function: Cleaves GlcNAc linked beta-1,4 to MurNAc tripeptides

COG id: COG1472

COG function: function code G; Beta-glucosidase-related glycosidases

Gene ontology:

Cell location: Cytoplasm

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the glycosyl hydrolase 3 family. NagZ subfamily

Homologues:

Organism=Escherichia coli, GI1787350, Length=292, Percent_Identity=56.1643835616438, Blast_Score=352, Evalue=2e-98,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NAGZ_PSYIN (A1SW90)

Other databases:

- EMBL:   CP000510
- RefSeq:   YP_943354.1
- ProteinModelPortal:   A1SW90
- SMR:   A1SW90
- STRING:   A1SW90
- GeneID:   4627231
- GenomeReviews:   CP000510_GR
- KEGG:   pin:Ping_1987
- eggNOG:   COG1472
- HOGENOM:   HBG617255
- OMA:   DLTMEGA
- PhylomeDB:   A1SW90
- BioCyc:   PING357804:PING_1987-MONOMER
- GO:   GO:0005737
- HAMAP:   MF_00364
- InterPro:   IPR022956
- InterPro:   IPR019800
- InterPro:   IPR001764
- InterPro:   IPR017853
- Gene3D:   G3DSA:3.20.20.300

Pfam domain/function: PF00933 Glyco_hydro_3; SSF51445 Glyco_hydro_cat

EC number: =3.2.1.52

Molecular weight: Translated: 37284; Mature: 37284

Theoretical pI: Translated: 5.83; Mature: 5.83

Prosite motif: PS00775 GLYCOSYL_HYDROL_F3

Important sites: ACT_SITE 248-248

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.5 %Cys     (Translated Protein)
2.7 %Met     (Translated Protein)
4.2 %Cys+Met (Translated Protein)
1.5 %Cys     (Mature Protein)
2.7 %Met     (Mature Protein)
4.2 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MRPVILDVEGYELDSEEKEILAHPLVAGIILFTRNYYDIEQLKALVKDIRRYAGNELLIA
CCCEEEECCCCCCCCHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHCCCEEEEE
VDHEGGRVQRFRDDFTRLPSAGSLIEKNDMKTACELAFSSAWVMASELIACDIDFSFAPV
EECCCCCHHHHHHHHHHCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHEEEECCCCCCCE
LDLNGISNVIQNRAFSSSITETVTLAEAYINGMKSAGMVSTGKHFPGHGSVEADSHTALP
EECCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCC
VDSRSELEIFTKDIKPFENLIKKGALDAVMPSHVVYSQCDLQPAGFSSYWLDDVLRTRLG
CCCCCHHHHHHHHHHHHHHHHHHCCHHHHCCCHHHHHHCCCCCCCCHHHHHHHHHHHHCC
FKGVVISDDLSMHGASFVGNHLSRAESAIQAGCDLILACNDRSGAVSILDNLKVKPTAQY
CCEEEEECCCCCCCHHHHHHHHHHHHHHHHCCCCEEEEECCCCCHHHHHHCCCCCCCHHH
HAVNQLRSTKNKFILPLNKNPIWIKNKQMLMQLSEQF
HHHHHHHHCCCCEEEEECCCCEEEECHHHHHHHHHCC
>Mature Secondary Structure
MRPVILDVEGYELDSEEKEILAHPLVAGIILFTRNYYDIEQLKALVKDIRRYAGNELLIA
CCCEEEECCCCCCCCHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHCCCEEEEE
VDHEGGRVQRFRDDFTRLPSAGSLIEKNDMKTACELAFSSAWVMASELIACDIDFSFAPV
EECCCCCHHHHHHHHHHCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHEEEECCCCCCCE
LDLNGISNVIQNRAFSSSITETVTLAEAYINGMKSAGMVSTGKHFPGHGSVEADSHTALP
EECCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCC
VDSRSELEIFTKDIKPFENLIKKGALDAVMPSHVVYSQCDLQPAGFSSYWLDDVLRTRLG
CCCCCHHHHHHHHHHHHHHHHHHCCHHHHCCCHHHHHHCCCCCCCCHHHHHHHHHHHHCC
FKGVVISDDLSMHGASFVGNHLSRAESAIQAGCDLILACNDRSGAVSILDNLKVKPTAQY
CCEEEEECCCCCCCHHHHHHHHHHHHHHHHCCCCEEEEECCCCCHHHHHHCCCCCCCHHH
HAVNQLRSTKNKFILPLNKNPIWIKNKQMLMQLSEQF
HHHHHHHHCCCCEEEEECCCCEEEECHHHHHHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: NA