The gene/protein map for NC_002679 is currently unavailable.
Definition Mesorhizobium loti MAFF303099 plasmid pMLa, complete sequence.
Accession NC_002679
Length 351,911

Click here to switch to the map view.

The map label for this gene is nagZ [H]

Identifier: 13488104

GI number: 13488104

Start: 144232

End: 145416

Strand: Reverse

Name: nagZ [H]

Synonym: mll9166

Alternate gene names: 13488104

Gene position: 145416-144232 (Counterclockwise)

Preceding gene: 13488105

Following gene: 13488103

Centisome position: 41.32

GC content: 60.17

Gene sequence:

>1185_bases
ATGTCGCGGTGGATCGCAACCTTCATAGCTGCCGCATGCACACTCCTTGGCATTTCCGCACCTCTGCGAGCTGACCCGGC
GCCGGAAGCCCACCTGCGGACGGCCAACCTGCACCGCGCCGTCGAAGATGGCAGACTGCGCCAAATGATCGGACAGATGG
TGCTGGTCGGCTTCGTCGGCGACAGTCCCGACGACGACGGATACAAGCGGGTCGTCAAACAGGCAGAGGCAGGTGAAATA
ACTGGCGTCATCTATCTGGGACGCAACATTTCGAGCCTTGAGGCCGTTCGGCAACTGAACAAGGGTTTGCAGCAATACGC
CACGGCCCCCCTGCTTGTCGCCATCGATCAGGAGGGGGGCCGCATCCAGAGGCTTACCGGCGAGGTCGGGTTCAGGGAGG
TGCCAAGCGAGGCGACCGTGGCAAAGACCATGAGTCCCGACGAGGCCAGCGTGGTTTACCAGGACCTCGCTTCAGATCTC
TCAAGCCTGGGATTCAACCTCAATCTGGCCCCGGTCGTCGACCTCAACGTCAACCCGGCGAATCCCATCATCGGCAAGCT
TGGCAGGAGCTTTTCCGCCGATCCGCAGAAAGTTGAAGCGTACGCCAGGGCTTTTATCGAAGCGCATCGCGCGAAGGGAG
TGCTAACGGCCCTGAAACACTTCCCTGGACATGGCTCCAGCACCAAGGACAGCCACAAGGGTATTGCAGACGTCACCAAG
ACATGGAGCGACAAGGAGCTTCTGCCTTATAAGGGCCTGATCGCGTCGGGGGACGTCGACATGGTCATGGCCGCGCACGT
GATAAACGCGAAGCTGGCCTTCTCCCCCGATATCCCCGCCTCGCTGTCCCGTGCGACGCTGACCACGCTTTTGCGCGACA
ACATGCACTTCAAGGGCGTGGTCATCAGCGATGACATGCAGATGCAGGCCATCACCGACAACGTCAGCTTCGAGGACTCG
GTGCTCCGGGCGGTCATGGCTGGCAACGACATCCTGATTTTCGCCAACGACAAACACCCTGACCCGGCCATCCCGGAAAA
GGTGGCCGCGATCCTTTCCGAGGAAGCGCAGCGGAATCCCGAAATGCTCGATCGCATCAAGACATCCTATGAAAACGTGA
TGCGCCTGAAAAGGAAGCTAGGATCGGCCGTTTCCCAGGAGACGACCGTGGTGAGGGAGCGATAG

Upstream 100 bases:

>100_bases
ACCTCTATCCGGTGCGCAGAAAAGGCATGACCTCGGCGCGGAAAAATAGCCGGACGGTCCAGCCTGACTTCGTTCGCCCC
GTCAGCCCAAGGAATTGAAT

Downstream 100 bases:

>100_bases
CGACCAGGCATGCGAAGCATGTTGGCGTTTGGCATCACGCGCACGACCGCAAGACTTCTCTTTGCGGTGGCAGTCGCCGC
CGTCCTGACTACTGGAGCCA

Product: glycosyl hydrolase family protein

Products: NA

Alternate protein names: Beta-N-acetylhexosaminidase; N-acetyl-beta-glucosaminidase [H]

Number of amino acids: Translated: 394; Mature: 393

Protein sequence:

>394_residues
MSRWIATFIAAACTLLGISAPLRADPAPEAHLRTANLHRAVEDGRLRQMIGQMVLVGFVGDSPDDDGYKRVVKQAEAGEI
TGVIYLGRNISSLEAVRQLNKGLQQYATAPLLVAIDQEGGRIQRLTGEVGFREVPSEATVAKTMSPDEASVVYQDLASDL
SSLGFNLNLAPVVDLNVNPANPIIGKLGRSFSADPQKVEAYARAFIEAHRAKGVLTALKHFPGHGSSTKDSHKGIADVTK
TWSDKELLPYKGLIASGDVDMVMAAHVINAKLAFSPDIPASLSRATLTTLLRDNMHFKGVVISDDMQMQAITDNVSFEDS
VLRAVMAGNDILIFANDKHPDPAIPEKVAAILSEEAQRNPEMLDRIKTSYENVMRLKRKLGSAVSQETTVVRER

Sequences:

>Translated_394_residues
MSRWIATFIAAACTLLGISAPLRADPAPEAHLRTANLHRAVEDGRLRQMIGQMVLVGFVGDSPDDDGYKRVVKQAEAGEI
TGVIYLGRNISSLEAVRQLNKGLQQYATAPLLVAIDQEGGRIQRLTGEVGFREVPSEATVAKTMSPDEASVVYQDLASDL
SSLGFNLNLAPVVDLNVNPANPIIGKLGRSFSADPQKVEAYARAFIEAHRAKGVLTALKHFPGHGSSTKDSHKGIADVTK
TWSDKELLPYKGLIASGDVDMVMAAHVINAKLAFSPDIPASLSRATLTTLLRDNMHFKGVVISDDMQMQAITDNVSFEDS
VLRAVMAGNDILIFANDKHPDPAIPEKVAAILSEEAQRNPEMLDRIKTSYENVMRLKRKLGSAVSQETTVVRER
>Mature_393_residues
SRWIATFIAAACTLLGISAPLRADPAPEAHLRTANLHRAVEDGRLRQMIGQMVLVGFVGDSPDDDGYKRVVKQAEAGEIT
GVIYLGRNISSLEAVRQLNKGLQQYATAPLLVAIDQEGGRIQRLTGEVGFREVPSEATVAKTMSPDEASVVYQDLASDLS
SLGFNLNLAPVVDLNVNPANPIIGKLGRSFSADPQKVEAYARAFIEAHRAKGVLTALKHFPGHGSSTKDSHKGIADVTKT
WSDKELLPYKGLIASGDVDMVMAAHVINAKLAFSPDIPASLSRATLTTLLRDNMHFKGVVISDDMQMQAITDNVSFEDSV
LRAVMAGNDILIFANDKHPDPAIPEKVAAILSEEAQRNPEMLDRIKTSYENVMRLKRKLGSAVSQETTVVRER

Specific function: Cleaves GlcNAc linked beta-1,4 to MurNAc tripeptides [H]

COG id: COG1472

COG function: function code G; Beta-glucosidase-related glycosidases

Gene ontology:

Cell location: Cytoplasm [H]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the glycosyl hydrolase 3 family. NagZ subfamily [H]

Homologues:

Organism=Escherichia coli, GI1787350, Length=286, Percent_Identity=31.4685314685315, Blast_Score=131, Evalue=8e-32,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR022956
- InterPro:   IPR019800
- InterPro:   IPR001764
- InterPro:   IPR017853 [H]

Pfam domain/function: PF00933 Glyco_hydro_3 [H]

EC number: =3.2.1.52 [H]

Molecular weight: Translated: 42718; Mature: 42587

Theoretical pI: Translated: 6.62; Mature: 6.62

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.3 %Cys     (Translated Protein)
3.0 %Met     (Translated Protein)
3.3 %Cys+Met (Translated Protein)
0.3 %Cys     (Mature Protein)
2.8 %Met     (Mature Protein)
3.1 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSRWIATFIAAACTLLGISAPLRADPAPEAHLRTANLHRAVEDGRLRQMIGQMVLVGFVG
CCHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHCHHHHHHHHHHHHHEECC
DSPDDDGYKRVVKQAEAGEITGVIYLGRNISSLEAVRQLNKGLQQYATAPLLVAIDQEGG
CCCCCHHHHHHHHHCCCCCEEEEEEECCCHHHHHHHHHHHHHHHHHCCCCEEEEEECCCC
RIQRLTGEVGFREVPSEATVAKTMSPDEASVVYQDLASDLSSLGFNLNLAPVVDLNVNPA
EEEEECCCCCCHHCCCCHHHHHCCCCCHHHHHHHHHHHHHHHCCCCCEEEEEEEECCCCC
NPIIGKLGRSFSADPQKVEAYARAFIEAHRAKGVLTALKHFPGHGSSTKDSHKGIADVTK
CHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCHHCCHHHHHH
TWSDKELLPYKGLIASGDVDMVMAAHVINAKLAFSPDIPASLSRATLTTLLRDNMHFKGV
CCCCCCCCCCCCEEECCCHHHHHHHHHHHCEEEECCCCCCHHHHHHHHHHHHCCCCEEEE
VISDDMQMQAITDNVSFEDSVLRAVMAGNDILIFANDKHPDPAIPEKVAAILSEEAQRNP
EEECCCEEEEECCCCCHHHHHHHHHHCCCEEEEEECCCCCCCCCHHHHHHHHHHHHHCCH
EMLDRIKTSYENVMRLKRKLGSAVSQETTVVRER
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCC
>Mature Secondary Structure 
SRWIATFIAAACTLLGISAPLRADPAPEAHLRTANLHRAVEDGRLRQMIGQMVLVGFVG
CHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHCHHHHHHHHHHHHHEECC
DSPDDDGYKRVVKQAEAGEITGVIYLGRNISSLEAVRQLNKGLQQYATAPLLVAIDQEGG
CCCCCHHHHHHHHHCCCCCEEEEEEECCCHHHHHHHHHHHHHHHHHCCCCEEEEEECCCC
RIQRLTGEVGFREVPSEATVAKTMSPDEASVVYQDLASDLSSLGFNLNLAPVVDLNVNPA
EEEEECCCCCCHHCCCCHHHHHCCCCCHHHHHHHHHHHHHHHCCCCCEEEEEEEECCCCC
NPIIGKLGRSFSADPQKVEAYARAFIEAHRAKGVLTALKHFPGHGSSTKDSHKGIADVTK
CHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCHHCCHHHHHH
TWSDKELLPYKGLIASGDVDMVMAAHVINAKLAFSPDIPASLSRATLTTLLRDNMHFKGV
CCCCCCCCCCCCEEECCCHHHHHHHHHHHCEEEECCCCCCHHHHHHHHHHHHCCCCEEEE
VISDDMQMQAITDNVSFEDSVLRAVMAGNDILIFANDKHPDPAIPEKVAAILSEEAQRNP
EEECCCEEEEECCCCCHHHHHHHHHHCCCEEEEEECCCCCCCCCHHHHHHHHHHHHHCCH
EMLDRIKTSYENVMRLKRKLGSAVSQETTVVRER
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA