Definition Chromobacterium violaceum ATCC 12472 chromosome, complete genome.
Accession NC_005085
Length 4,751,080

Click here to switch to the map view.

The map label for this gene is nagD [H]

Identifier: 34498699

GI number: 34498699

Start: 3524029

End: 3524976

Strand: Reverse

Name: nagD [H]

Synonym: CV_3244

Alternate gene names: 34498699

Gene position: 3524976-3524029 (Counterclockwise)

Preceding gene: 34498701

Following gene: 34498691

Centisome position: 74.19

GC content: 64.66

Gene sequence:

>948_bases
ATGCGGAATTTCCCGCCATCTTGCCATCCGGTAGCTCTCCGGCATGCCGGACCTGGCCGGCGCGGCGAGGCTGAGGCGCG
GCCATGCTATGCTGTGGCCGTTGCGGCGGCATGCCGTAGCCCGCGACCGTGCCCGCGCAGCCGGCACCAAGTGTTCTGGA
TACACCGTATGAGCAAGAGCATCATTTCCGACATGGATGGCGTGATCTACCGAGGCAAGCAGCTGATCCCCGGCGCGCGC
GAATTCATCCAGCGCCTGATCGACACCCAAACGCCCTTCCTGTTTCTGACCAACAACGCCGAGCAGACTCCGCTGGACCT
GAGGCTGAAGCTGGAGGGCCTGGGCATTTCCGGCCTGACCGAGGACAACTTCATCACCAGCGCGATGGCGACGGCGATGT
TCCTGAAAAGCCAGACCCGCAAGGCGATGCCCACCGCCTACGTGGTGGGCGGCGCGGGCCTGATCAACGAGCTCTACAAC
GTCGGCTTCTCGATTTCGGAGTCGCATCCGGACTACGTGGTGGTGGCCAAGTCGCAGACCTTCAGCTTCGAGCAGATCAA
GAAGGCGGTGCGCTTCATCGACCAGGGCGCCAAGTTCATCGGCACCAACCCCGACATGATCGACCCGATAGAGGGCGGCG
GCTACGAGCCGGCGGCCGGCACGCTGCTGGCGGCGATCGAGGCCGCCACCGGCCGGAAGCCCTACATCGTCGGCAAGCCC
AACTCCCTGATGATGATGCTGGCCACCCGCAAGCTGGGCGTGCATCCGGAAGAGGCGGTGATGATAGGCGACCGCATGGA
TACCGACATCGTCGGCGGGCTGGAGGCCGGCATGAGCACCGCGCTGGTGTTGTCCGGCGTGTCCAGCCGCGCATCGATGG
AGCAATTTCCCTACCAGCCGGACTACGTGTTCGACAGCGTGGCCGACATCGATCCGCAGGCGCTGTGA

Upstream 100 bases:

>100_bases
GCCGATGCCGCGAGGGGCGTCCGCCGGACTGACGGTCTGAACGGGAAATGTGCTGTTCGTTCCATGGGTTTACGGTCTGT
TGGCAATACAGTGCGTTCGC

Downstream 100 bases:

>100_bases
CGGCCAGGGGCCGCCGGGCGCTTACGACAGCTGACCCGCTCCGGCTTCCGCGCGGGCCGGCGCGGCGGAGGCGAACGCCC
GCGGGCTGACCCAGGCGCCG

Product: N-acetylglucosamine metabolism protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 315; Mature: 315

Protein sequence:

>315_residues
MRNFPPSCHPVALRHAGPGRRGEAEARPCYAVAVAAACRSPRPCPRSRHQVFWIHRMSKSIISDMDGVIYRGKQLIPGAR
EFIQRLIDTQTPFLFLTNNAEQTPLDLRLKLEGLGISGLTEDNFITSAMATAMFLKSQTRKAMPTAYVVGGAGLINELYN
VGFSISESHPDYVVVAKSQTFSFEQIKKAVRFIDQGAKFIGTNPDMIDPIEGGGYEPAAGTLLAAIEAATGRKPYIVGKP
NSLMMMLATRKLGVHPEEAVMIGDRMDTDIVGGLEAGMSTALVLSGVSSRASMEQFPYQPDYVFDSVADIDPQAL

Sequences:

>Translated_315_residues
MRNFPPSCHPVALRHAGPGRRGEAEARPCYAVAVAAACRSPRPCPRSRHQVFWIHRMSKSIISDMDGVIYRGKQLIPGAR
EFIQRLIDTQTPFLFLTNNAEQTPLDLRLKLEGLGISGLTEDNFITSAMATAMFLKSQTRKAMPTAYVVGGAGLINELYN
VGFSISESHPDYVVVAKSQTFSFEQIKKAVRFIDQGAKFIGTNPDMIDPIEGGGYEPAAGTLLAAIEAATGRKPYIVGKP
NSLMMMLATRKLGVHPEEAVMIGDRMDTDIVGGLEAGMSTALVLSGVSSRASMEQFPYQPDYVFDSVADIDPQAL
>Mature_315_residues
MRNFPPSCHPVALRHAGPGRRGEAEARPCYAVAVAAACRSPRPCPRSRHQVFWIHRMSKSIISDMDGVIYRGKQLIPGAR
EFIQRLIDTQTPFLFLTNNAEQTPLDLRLKLEGLGISGLTEDNFITSAMATAMFLKSQTRKAMPTAYVVGGAGLINELYN
VGFSISESHPDYVVVAKSQTFSFEQIKKAVRFIDQGAKFIGTNPDMIDPIEGGGYEPAAGTLLAAIEAATGRKPYIVGKP
NSLMMMLATRKLGVHPEEAVMIGDRMDTDIVGGLEAGMSTALVLSGVSSRASMEQFPYQPDYVFDSVADIDPQAL

Specific function: Unknown

COG id: COG0647

COG function: function code G; Predicted sugar phosphatases of the HAD superfamily

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

Organism=Homo sapiens, GI10092677, Length=273, Percent_Identity=31.1355311355311, Blast_Score=141, Evalue=8e-34,
Organism=Homo sapiens, GI108796653, Length=288, Percent_Identity=31.5972222222222, Blast_Score=130, Evalue=2e-30,
Organism=Homo sapiens, GI14149777, Length=250, Percent_Identity=29.2, Blast_Score=88, Evalue=9e-18,
Organism=Homo sapiens, GI269847098, Length=271, Percent_Identity=26.9372693726937, Blast_Score=70, Evalue=2e-12,
Organism=Escherichia coli, GI1786890, Length=253, Percent_Identity=42.6877470355731, Blast_Score=213, Evalue=2e-56,
Organism=Caenorhabditis elegans, GI17562458, Length=322, Percent_Identity=28.5714285714286, Blast_Score=115, Evalue=3e-26,
Organism=Caenorhabditis elegans, GI17560956, Length=314, Percent_Identity=28.9808917197452, Blast_Score=112, Evalue=2e-25,
Organism=Caenorhabditis elegans, GI17558880, Length=303, Percent_Identity=30.03300330033, Blast_Score=109, Evalue=2e-24,
Organism=Caenorhabditis elegans, GI193210059, Length=270, Percent_Identity=31.8518518518519, Blast_Score=105, Evalue=3e-23,
Organism=Caenorhabditis elegans, GI86563050, Length=265, Percent_Identity=31.6981132075472, Blast_Score=102, Evalue=3e-22,
Organism=Caenorhabditis elegans, GI71984613, Length=268, Percent_Identity=29.4776119402985, Blast_Score=84, Evalue=7e-17,
Organism=Caenorhabditis elegans, GI17557870, Length=263, Percent_Identity=26.2357414448669, Blast_Score=68, Evalue=6e-12,
Organism=Caenorhabditis elegans, GI17562356, Length=236, Percent_Identity=28.3898305084746, Blast_Score=64, Evalue=9e-11,
Organism=Saccharomyces cerevisiae, GI6319965, Length=237, Percent_Identity=24.4725738396624, Blast_Score=77, Evalue=3e-15,
Organism=Drosophila melanogaster, GI24666141, Length=265, Percent_Identity=30.5660377358491, Blast_Score=107, Evalue=1e-23,
Organism=Drosophila melanogaster, GI24656326, Length=279, Percent_Identity=27.5985663082437, Blast_Score=97, Evalue=1e-20,
Organism=Drosophila melanogaster, GI24656330, Length=259, Percent_Identity=29.7297297297297, Blast_Score=93, Evalue=2e-19,
Organism=Drosophila melanogaster, GI24666137, Length=295, Percent_Identity=24.7457627118644, Blast_Score=76, Evalue=3e-14,
Organism=Drosophila melanogaster, GI22026920, Length=252, Percent_Identity=26.1904761904762, Blast_Score=74, Evalue=2e-13,
Organism=Drosophila melanogaster, GI18859765, Length=277, Percent_Identity=26.3537906137184, Blast_Score=66, Evalue=4e-11,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR005834
- InterPro:   IPR023214
- InterPro:   IPR006357
- InterPro:   IPR023215 [H]

Pfam domain/function: PF00702 Hydrolase [H]

EC number: NA

Molecular weight: Translated: 34256; Mature: 34256

Theoretical pI: Translated: 7.54; Mature: 7.54

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.3 %Cys     (Translated Protein)
4.4 %Met     (Translated Protein)
5.7 %Cys+Met (Translated Protein)
1.3 %Cys     (Mature Protein)
4.4 %Met     (Mature Protein)
5.7 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MRNFPPSCHPVALRHAGPGRRGEAEARPCYAVAVAAACRSPRPCPRSRHQVFWIHRMSKS
CCCCCCCCCCEEEECCCCCCCCCCCCCCHHHHHHHHHHCCCCCCCCCCCEEEEHHHHHHH
IISDMDGVIYRGKQLIPGAREFIQRLIDTQTPFLFLTNNAEQTPLDLRLKLEGLGISGLT
HHHHHCHHHHCCCCCCCCHHHHHHHHHCCCCCEEEEECCCCCCCEEEEEEEEECCCCCCC
EDNFITSAMATAMFLKSQTRKAMPTAYVVGGAGLINELYNVGFSISESHPDYVVVAKSQT
CCHHHHHHHHHHHHHHHHHHHCCCEEEEECCHHHHHHHHHCCCEECCCCCCEEEEECCCC
FSFEQIKKAVRFIDQGAKFIGTNPDMIDPIEGGGYEPAAGTLLAAIEAATGRKPYIVGKP
CCHHHHHHHHHHHHCCCCEECCCCCCCCCCCCCCCCCHHHHHHHHHHHHCCCCCEEEECC
NSLMMMLATRKLGVHPEEAVMIGDRMDTDIVGGLEAGMSTALVLSGVSSRASMEQFPYQP
CCEEEEEEHHHCCCCCHHEEEECCCCCCHHHHHHHHHHHHHHHHHCCCCHHHHHHCCCCC
DYVFDSVADIDPQAL
CHHHHHHHCCCCCCC
>Mature Secondary Structure
MRNFPPSCHPVALRHAGPGRRGEAEARPCYAVAVAAACRSPRPCPRSRHQVFWIHRMSKS
CCCCCCCCCCEEEECCCCCCCCCCCCCCHHHHHHHHHHCCCCCCCCCCCEEEEHHHHHHH
IISDMDGVIYRGKQLIPGAREFIQRLIDTQTPFLFLTNNAEQTPLDLRLKLEGLGISGLT
HHHHHCHHHHCCCCCCCCHHHHHHHHHCCCCCEEEEECCCCCCCEEEEEEEEECCCCCCC
EDNFITSAMATAMFLKSQTRKAMPTAYVVGGAGLINELYNVGFSISESHPDYVVVAKSQT
CCHHHHHHHHHHHHHHHHHHHCCCEEEEECCHHHHHHHHHCCCEECCCCCCEEEEECCCC
FSFEQIKKAVRFIDQGAKFIGTNPDMIDPIEGGGYEPAAGTLLAAIEAATGRKPYIVGKP
CCHHHHHHHHHHHHCCCCEECCCCCCCCCCCCCCCCCHHHHHHHHHHHHCCCCCEEEECC
NSLMMMLATRKLGVHPEEAVMIGDRMDTDIVGGLEAGMSTALVLSGVSSRASMEQFPYQP
CCEEEEEEHHHCCCCCHHEEEECCCCCCHHHHHHHHHHHHHHHHHCCCCHHHHHHCCCCC
DYVFDSVADIDPQAL
CHHHHHHHCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: 11206551; 11258796 [H]