Definition Shewanella amazonensis SB2B chromosome, complete genome.
Accession NC_008700
Length 4,306,142

Click here to switch to the map view.

The map label for this gene is nagA [H]

Identifier: 119774335

GI number: 119774335

Start: 1468421

End: 1469656

Strand: Direct

Name: nagA [H]

Synonym: Sama_1198

Alternate gene names: 119774335

Gene position: 1468421-1469656 (Clockwise)

Preceding gene: 119774334

Following gene: 119774336

Centisome position: 34.1

GC content: 60.19

Gene sequence:

>1236_bases
ATGGCTGACGTAGGTAGCAACTGTTTGCCTGAAAACCTCAACGATTGCTGGCTCAATCCCGAGTTTGTACTCGTCGGTGC
TGACGATGCATCTGAGTTTGGTGTAACAGGCAATGCCATTGCGGCTTTAGTGCCGGATGTGTGGCTGAAAATAAGCCAAG
GCCACATCGAGACCATATCGCGTAGGCCCGATGTCGATTTACCTCAATATCGGCTGCCGGGCATTCTGGCTCCGGCGCTG
GTGGATACCCAGGTTAATGGCGGTGGTGGGGTTCTCATCAATCACCAGCCCACGGCGGCTGGTATCAACACCCTTACTCA
AACCCACGGCCAGTATGGGACCGGCGCACTTTTGCCCACGGTAATAAGTGACAATCTTGCCGTGATGGAGCAGGCGCTCG
ACGGCGCCATTGCCGCAAGGCAAGGGGGCGATGCCGCTGTGGTGGGCATTCATTTTGAAGGGCCGCACCTGTCACTCGCC
AAAAAGGGGTGTCACAGTCCGGCACTTATTCGCCCCATCGGCGAGGCGGAAATGACTCTCTACGCGGACGCTGTCGCCGC
CCTCGGATGCTGCATGGTGACATTGGCACCGGAAACTGTCGAACCGGCCGATATCGCGCGTTTGGTGGCGCTCGGTGTCA
GGGTCAGCCTTGGCCACTCCAATGCCGATGTTGCCACGGTCGAGGCCAGTCTCGCGGCGGGGGCCAGTGGATTCACCCAC
CTCTTTAATGGCATGTCGGCCCTGCAAGGGCGAGAGCCGGGTATGGTGGGGGCCGCGCTGGCCTGCCCTGAAGCATATTG
CGGCATTATTCTGGATGGGGAGCATGTGCACGCCACCTCGGCGACCCTGGCCTGGCGCCTTAAAGGCACTCGGCGACTCA
TGTTGGTCACGGATGCCATGTCGCCCACAGGCACCCGGGAAGAGAGTTTTGAATTTTTCGGTGGCAAGGTGCACAGGGAT
GGCATGGTGCTTCGGGACGAACAGGGTTCATTGGCGGGCTCTGTGCTGACCATGACGGCAGCGGTGCGTCAGGCCTGTGC
CATGCTCGGCGTGAGTGCGGCCGAGGCCCTGTGGATGGCTACAGCCACACCGGCCGCATTTTTGGGCCTGAAGGACATAG
GCCGATTGGCGCCGGGTAATCGCGCCGACCTGTTGCTGCTGGATGATGCCCTTTATCAACTGGGCCGCTGGCAAGCCGGT
CAGCTGGTGGCAGGCCAAGAGCCTCCATTGGATTAA

Upstream 100 bases:

>100_bases
GTACGCGGGGCCGCGCTGCTGGGTAAGGCGCTCAGCGAAGATTACCTTGCTGACGCTCTCAGCGTAGAAATGGGGCCCGA
AGAACTTCAAAGGAGGCTCC

Downstream 100 bases:

>100_bases
AAGCGCCCTTATTGGCAAAAGTGCAGAAATAAAAGAAACCGGAATGGAATAGAAGCTGGATAACCCTATGGAAAATATAA
TGAAAACAACCAAGACCTCT

Product: N-acetylglucosamine-6-phosphate deacetylase

Products: NA

Alternate protein names: GlcNAc 6-P deacetylase [H]

Number of amino acids: Translated: 411; Mature: 410

Protein sequence:

>411_residues
MADVGSNCLPENLNDCWLNPEFVLVGADDASEFGVTGNAIAALVPDVWLKISQGHIETISRRPDVDLPQYRLPGILAPAL
VDTQVNGGGGVLINHQPTAAGINTLTQTHGQYGTGALLPTVISDNLAVMEQALDGAIAARQGGDAAVVGIHFEGPHLSLA
KKGCHSPALIRPIGEAEMTLYADAVAALGCCMVTLAPETVEPADIARLVALGVRVSLGHSNADVATVEASLAAGASGFTH
LFNGMSALQGREPGMVGAALACPEAYCGIILDGEHVHATSATLAWRLKGTRRLMLVTDAMSPTGTREESFEFFGGKVHRD
GMVLRDEQGSLAGSVLTMTAAVRQACAMLGVSAAEALWMATATPAAFLGLKDIGRLAPGNRADLLLLDDALYQLGRWQAG
QLVAGQEPPLD

Sequences:

>Translated_411_residues
MADVGSNCLPENLNDCWLNPEFVLVGADDASEFGVTGNAIAALVPDVWLKISQGHIETISRRPDVDLPQYRLPGILAPAL
VDTQVNGGGGVLINHQPTAAGINTLTQTHGQYGTGALLPTVISDNLAVMEQALDGAIAARQGGDAAVVGIHFEGPHLSLA
KKGCHSPALIRPIGEAEMTLYADAVAALGCCMVTLAPETVEPADIARLVALGVRVSLGHSNADVATVEASLAAGASGFTH
LFNGMSALQGREPGMVGAALACPEAYCGIILDGEHVHATSATLAWRLKGTRRLMLVTDAMSPTGTREESFEFFGGKVHRD
GMVLRDEQGSLAGSVLTMTAAVRQACAMLGVSAAEALWMATATPAAFLGLKDIGRLAPGNRADLLLLDDALYQLGRWQAG
QLVAGQEPPLD
>Mature_410_residues
ADVGSNCLPENLNDCWLNPEFVLVGADDASEFGVTGNAIAALVPDVWLKISQGHIETISRRPDVDLPQYRLPGILAPALV
DTQVNGGGGVLINHQPTAAGINTLTQTHGQYGTGALLPTVISDNLAVMEQALDGAIAARQGGDAAVVGIHFEGPHLSLAK
KGCHSPALIRPIGEAEMTLYADAVAALGCCMVTLAPETVEPADIARLVALGVRVSLGHSNADVATVEASLAAGASGFTHL
FNGMSALQGREPGMVGAALACPEAYCGIILDGEHVHATSATLAWRLKGTRRLMLVTDAMSPTGTREESFEFFGGKVHRDG
MVLRDEQGSLAGSVLTMTAAVRQACAMLGVSAAEALWMATATPAAFLGLKDIGRLAPGNRADLLLLDDALYQLGRWQAGQ
LVAGQEPPLD

Specific function: N-acetylglucosamine utilization. [C]

COG id: COG1820

COG function: function code G; N-acetylglucosamine-6-phosphate deacetylase

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the nagA family [H]

Homologues:

Organism=Homo sapiens, GI21361513, Length=375, Percent_Identity=32, Blast_Score=133, Evalue=4e-31,
Organism=Homo sapiens, GI224922791, Length=377, Percent_Identity=31.8302387267904, Blast_Score=132, Evalue=8e-31,
Organism=Escherichia coli, GI1786892, Length=352, Percent_Identity=37.7840909090909, Blast_Score=190, Evalue=1e-49,
Organism=Caenorhabditis elegans, GI17553768, Length=352, Percent_Identity=30.3977272727273, Blast_Score=125, Evalue=5e-29,
Organism=Drosophila melanogaster, GI19920392, Length=346, Percent_Identity=34.6820809248555, Blast_Score=145, Evalue=5e-35,
Organism=Drosophila melanogaster, GI281361140, Length=360, Percent_Identity=33.3333333333333, Blast_Score=138, Evalue=7e-33,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR006680
- InterPro:   IPR003764
- InterPro:   IPR011059 [H]

Pfam domain/function: PF01979 Amidohydro_1 [H]

EC number: =3.5.1.25 [H]

Molecular weight: Translated: 42634; Mature: 42503

Theoretical pI: Translated: 4.64; Mature: 4.64

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.9 %Cys     (Translated Protein)
2.9 %Met     (Translated Protein)
4.9 %Cys+Met (Translated Protein)
2.0 %Cys     (Mature Protein)
2.7 %Met     (Mature Protein)
4.6 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MADVGSNCLPENLNDCWLNPEFVLVGADDASEFGVTGNAIAALVPDVWLKISQGHIETIS
CCCCCCCCCCCCCHHHCCCCCEEEEECCCCHHCCCCCCHHHHHHHHHHEEECCCHHHHHH
RRPDVDLPQYRLPGILAPALVDTQVNGGGGVLINHQPTAAGINTLTQTHGQYGTGALLPT
CCCCCCCCCCCCCCHHCCHHEEEEECCCCEEEEECCCCHHHHHHHHHHCCCCCCCCHHHH
VISDNLAVMEQALDGAIAARQGGDAAVVGIHFEGPHLSLAKKGCHSPALIRPIGEAEMTL
HHCCCHHHHHHHHCCHHEECCCCCEEEEEEEECCCCCHHHHHCCCCCCEEEECCCCHHHH
YADAVAALGCCMVTLAPETVEPADIARLVALGVRVSLGHSNADVATVEASLAAGASGFTH
HHHHHHHHHHHEEEECCCCCCHHHHHHHHHHHEEEEECCCCCCEEEEEHHHHCCCCHHHH
LFNGMSALQGREPGMVGAALACPEAYCGIILDGEHVHATSATLAWRLKGTRRLMLVTDAM
HHHHHHHHCCCCCCCEEHHHHCCHHHEEEEECCCEEEECCEEEEEEECCCEEEEEEEECC
SPTGTREESFEFFGGKVHRDGMVLRDEQGSLAGSVLTMTAAVRQACAMLGVSAAEALWMA
CCCCCCCHHHHHCCCEEECCCEEEECCCCCHHHHHHHHHHHHHHHHHHHCCHHHHHHHHE
TATPAAFLGLKDIGRLAPGNRADLLLLDDALYQLGRWQAGQLVAGQEPPLD
CCCCHHHHCHHHHHHCCCCCCCCEEEEEHHHHHHCCCCCCCEECCCCCCCC
>Mature Secondary Structure 
ADVGSNCLPENLNDCWLNPEFVLVGADDASEFGVTGNAIAALVPDVWLKISQGHIETIS
CCCCCCCCCCCCHHHCCCCCEEEEECCCCHHCCCCCCHHHHHHHHHHEEECCCHHHHHH
RRPDVDLPQYRLPGILAPALVDTQVNGGGGVLINHQPTAAGINTLTQTHGQYGTGALLPT
CCCCCCCCCCCCCCHHCCHHEEEEECCCCEEEEECCCCHHHHHHHHHHCCCCCCCCHHHH
VISDNLAVMEQALDGAIAARQGGDAAVVGIHFEGPHLSLAKKGCHSPALIRPIGEAEMTL
HHCCCHHHHHHHHCCHHEECCCCCEEEEEEEECCCCCHHHHHCCCCCCEEEECCCCHHHH
YADAVAALGCCMVTLAPETVEPADIARLVALGVRVSLGHSNADVATVEASLAAGASGFTH
HHHHHHHHHHHEEEECCCCCCHHHHHHHHHHHEEEEECCCCCCEEEEEHHHHCCCCHHHH
LFNGMSALQGREPGMVGAALACPEAYCGIILDGEHVHATSATLAWRLKGTRRLMLVTDAM
HHHHHHHHCCCCCCCEEHHHHCCHHHEEEEECCCEEEECCEEEEEEECCCEEEEEEEECC
SPTGTREESFEFFGGKVHRDGMVLRDEQGSLAGSVLTMTAAVRQACAMLGVSAAEALWMA
CCCCCCCHHHHHCCCEEECCCEEEECCCCCHHHHHHHHHHHHHHHHHHHCCHHHHHHHHE
TATPAAFLGLKDIGRLAPGNRADLLLLDDALYQLGRWQAGQLVAGQEPPLD
CCCCHHHHCHHHHHHCCCCCCCCEEEEEHHHHHHCCCCCCCEECCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 9301118; 10952301 [H]