Definition Shigella boydii Sb227, complete genome.
Accession NC_007613
Length 4,519,823

Click here to switch to the map view.

The map label for this gene is nagD [H]

Identifier: 82543110

GI number: 82543110

Start: 550456

End: 551208

Strand: Reverse

Name: nagD [H]

Synonym: SBO_0537

Alternate gene names: 82543110

Gene position: 551208-550456 (Counterclockwise)

Preceding gene: 82543111

Following gene: 82543109

Centisome position: 12.2

GC content: 52.46

Gene sequence:

>753_bases
ATGACCATTAAAAATGTAATTTGCGATATCGATGGCGTGCTGATGCACGATAACGTCGCCGTACCGGGTGCAGCGGAATT
TTTGCACGGGATTATGGATAAAGGCCTGCCGCTGGTGTTGCTGACCAACTATCCTTCGCAGACTGGGCAAGATCTGGCGA
ACCGCTTTGCCACCGCAGGTGTCGATGTACCTGACAGCGTGTTTTATACCTCTGCGATGGCGACTGCCGATTTCCTGCGT
CGCCAGGAAGGCAAGAAAGCGTATGTGGTGGGCGAAGGCGCACTGATTCATGAACTGTACAAAGCCGGTTTCACTATTAC
CGATGTGAACCCTGATTTCGTGATTGTTGGCGAAACGAGTTCCTACAACTGGGACATGATGCATAAAGCAGCCTATTTCG
TCGCTAACGGTGCACGTTTTATCGCCACCAATCCGGACACCCACGGGCGCGGTTTTTATCCCGCGTGTGGCGCGTTGTGT
GCAGGCATCGAAAAAATCTCCGGGCGTAAACCGTTCTATGTTGGTAAACCGAGTCCGTGGATCATCCGCGCGGCATTAAA
CAAAATGCAGGCGCATTCGGAAGAAACGGTGATTGTCGGCGATAACCTGCGTACCGATATTCTGGCGGGCTTCCAGGCAG
GTCTGGAAACGATTCTGGTGCTTTCTGGTGTTTCATCGCTCGACGATATCGACAGTATGCCGTTCCGCCCAAGCTGGATT
TACCCGTCGGTCGCTGAAATCGACGTTATCTGA

Upstream 100 bases:

>100_bases
TAAAACGCGCCATGCTCAACGGTATTTTGCTCCAGCATTTGCTGGAAAATTAATGTGCTTTTATAGTGGCGCTTATTGTT
GTCAATATTCTGGGTAGTCC

Downstream 100 bases:

>100_bases
ATAGCAACCACGTCTGCGGACGTGGTTGGCTCTGATGACAAACGCCAAACTGCCTGATGCGCTACGCTTATCAGGCCTAC
GCAGCTCCTGCAATATATTG

Product: UMP phosphatase

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 250; Mature: 249

Protein sequence:

>250_residues
MTIKNVICDIDGVLMHDNVAVPGAAEFLHGIMDKGLPLVLLTNYPSQTGQDLANRFATAGVDVPDSVFYTSAMATADFLR
RQEGKKAYVVGEGALIHELYKAGFTITDVNPDFVIVGETSSYNWDMMHKAAYFVANGARFIATNPDTHGRGFYPACGALC
AGIEKISGRKPFYVGKPSPWIIRAALNKMQAHSEETVIVGDNLRTDILAGFQAGLETILVLSGVSSLDDIDSMPFRPSWI
YPSVAEIDVI

Sequences:

>Translated_250_residues
MTIKNVICDIDGVLMHDNVAVPGAAEFLHGIMDKGLPLVLLTNYPSQTGQDLANRFATAGVDVPDSVFYTSAMATADFLR
RQEGKKAYVVGEGALIHELYKAGFTITDVNPDFVIVGETSSYNWDMMHKAAYFVANGARFIATNPDTHGRGFYPACGALC
AGIEKISGRKPFYVGKPSPWIIRAALNKMQAHSEETVIVGDNLRTDILAGFQAGLETILVLSGVSSLDDIDSMPFRPSWI
YPSVAEIDVI
>Mature_249_residues
TIKNVICDIDGVLMHDNVAVPGAAEFLHGIMDKGLPLVLLTNYPSQTGQDLANRFATAGVDVPDSVFYTSAMATADFLRR
QEGKKAYVVGEGALIHELYKAGFTITDVNPDFVIVGETSSYNWDMMHKAAYFVANGARFIATNPDTHGRGFYPACGALCA
GIEKISGRKPFYVGKPSPWIIRAALNKMQAHSEETVIVGDNLRTDILAGFQAGLETILVLSGVSSLDDIDSMPFRPSWIY
PSVAEIDVI

Specific function: Unknown

COG id: COG0647

COG function: function code G; Predicted sugar phosphatases of the HAD superfamily

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

Organism=Homo sapiens, GI108796653, Length=265, Percent_Identity=31.3207547169811, Blast_Score=98, Evalue=8e-21,
Organism=Homo sapiens, GI10092677, Length=252, Percent_Identity=29.7619047619048, Blast_Score=98, Evalue=9e-21,
Organism=Homo sapiens, GI14149777, Length=247, Percent_Identity=25.5060728744939, Blast_Score=81, Evalue=8e-16,
Organism=Escherichia coli, GI1786890, Length=250, Percent_Identity=99.6, Blast_Score=516, Evalue=1e-148,
Organism=Caenorhabditis elegans, GI17558880, Length=263, Percent_Identity=27.3764258555133, Blast_Score=89, Evalue=1e-18,
Organism=Caenorhabditis elegans, GI17560956, Length=263, Percent_Identity=27.3764258555133, Blast_Score=89, Evalue=2e-18,
Organism=Caenorhabditis elegans, GI17562458, Length=286, Percent_Identity=26.5734265734266, Blast_Score=89, Evalue=2e-18,
Organism=Caenorhabditis elegans, GI71984613, Length=264, Percent_Identity=28.4090909090909, Blast_Score=77, Evalue=6e-15,
Organism=Caenorhabditis elegans, GI17562356, Length=233, Percent_Identity=23.6051502145923, Blast_Score=67, Evalue=1e-11,
Organism=Caenorhabditis elegans, GI193210059, Length=258, Percent_Identity=23.6434108527132, Blast_Score=65, Evalue=4e-11,
Organism=Saccharomyces cerevisiae, GI6319965, Length=234, Percent_Identity=27.3504273504274, Blast_Score=82, Evalue=8e-17,
Organism=Drosophila melanogaster, GI24666141, Length=253, Percent_Identity=27.2727272727273, Blast_Score=105, Evalue=4e-23,
Organism=Drosophila melanogaster, GI24656326, Length=258, Percent_Identity=26.7441860465116, Blast_Score=97, Evalue=1e-20,
Organism=Drosophila melanogaster, GI22026920, Length=243, Percent_Identity=27.9835390946502, Blast_Score=95, Evalue=5e-20,
Organism=Drosophila melanogaster, GI24666137, Length=291, Percent_Identity=27.4914089347079, Blast_Score=89, Evalue=3e-18,
Organism=Drosophila melanogaster, GI24656330, Length=275, Percent_Identity=27.2727272727273, Blast_Score=82, Evalue=3e-16,
Organism=Drosophila melanogaster, GI19920940, Length=261, Percent_Identity=23.3716475095785, Blast_Score=74, Evalue=1e-13,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR005834
- InterPro:   IPR023214
- InterPro:   IPR006357
- InterPro:   IPR023215 [H]

Pfam domain/function: PF00702 Hydrolase [H]

EC number: NA

Molecular weight: Translated: 27094; Mature: 26963

Theoretical pI: Translated: 4.89; Mature: 4.89

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.2 %Cys     (Translated Protein)
3.2 %Met     (Translated Protein)
4.4 %Cys+Met (Translated Protein)
1.2 %Cys     (Mature Protein)
2.8 %Met     (Mature Protein)
4.0 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MTIKNVICDIDGVLMHDNVAVPGAAEFLHGIMDKGLPLVLLTNYPSQTGQDLANRFATAG
CCHHHEEECCCCEEEECCCCCCCHHHHHHHHHHCCCCEEEEECCCCHHHHHHHHHHHHCC
VDVPDSVFYTSAMATADFLRRQEGKKAYVVGEGALIHELYKAGFTITDVNPDFVIVGETS
CCCCCHHHHHHHHHHHHHHHHHCCCEEEEEECCHHHHHHHHCCCEEEECCCCEEEEECCC
SYNWDMMHKAAYFVANGARFIATNPDTHGRGFYPACGALCAGIEKISGRKPFYVGKPSPW
CCCHHHHHHHEEEEECCCEEEEECCCCCCCCCCHHHHHHHHHHHHHCCCCCEEECCCCCC
IIRAALNKMQAHSEETVIVGDNLRTDILAGFQAGLETILVLSGVSSLDDIDSMPFRPSWI
HHHHHHHHHHCCCCCEEEECCCCHHHHHHHHHHHHHHHHHHHCCCCHHHHCCCCCCCCCC
YPSVAEIDVI
CCCHHEEECC
>Mature Secondary Structure 
TIKNVICDIDGVLMHDNVAVPGAAEFLHGIMDKGLPLVLLTNYPSQTGQDLANRFATAG
CHHHEEECCCCEEEECCCCCCCHHHHHHHHHHCCCCEEEEECCCCHHHHHHHHHHHHCC
VDVPDSVFYTSAMATADFLRRQEGKKAYVVGEGALIHELYKAGFTITDVNPDFVIVGETS
CCCCCHHHHHHHHHHHHHHHHHCCCEEEEEECCHHHHHHHHCCCEEEECCCCEEEEECCC
SYNWDMMHKAAYFVANGARFIATNPDTHGRGFYPACGALCAGIEKISGRKPFYVGKPSPW
CCCHHHHHHHEEEEECCCEEEEECCCCCCCCCCHHHHHHHHHHHHHCCCCCEEECCCCCC
IIRAALNKMQAHSEETVIVGDNLRTDILAGFQAGLETILVLSGVSSLDDIDSMPFRPSWI
HHHHHHHHHHCCCCCEEEECCCCHHHHHHHHHHHHHHHHHHHCCCCHHHHCCCCCCCCCC
YPSVAEIDVI
CCCHHEEECC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: 11206551; 11258796 [H]