The gene/protein map for NC_011773 is currently unavailable.
Definition Bacillus cereus AH820, complete genome.
Accession NC_011773
Length 5,302,683

Click here to switch to the map view.

The map label for this gene is glmU [H]

Identifier: 218905403

GI number: 218905403

Start: 4074577

End: 4076931

Strand: Reverse

Name: glmU [H]

Synonym: BCAH820_4287

Alternate gene names: 218905403

Gene position: 4076931-4074577 (Counterclockwise)

Preceding gene: 218905404

Following gene: 218905402

Centisome position: 76.88

GC content: 36.05

Gene sequence:

>2355_bases
ATGAAGGGGGTTATTTTAGCTGGAGGAAAAGGACGACGCCTTAGACCATTAACATGTAATACTCCAAAGCCGATGTTGCC
ATTATTAGAAAAGCCAGTTTTGGAATACAATATTGAATTATTGCGTCAGCATGGTATACGTGAGATTGCAATTACTGTTC
AGTATATGAGTACGGCCATTAAGCAATATTTTGGTGACGGTAGCAAATGGGGCGTTAACTTGTACTACTTTGAAGACTCT
CCACCGCTTGGAACTGCAGGGAGTATTAAACAAGCGGAAAAATTTTTGGATGAAACGTTTGTTGTCATAAGTGGGGATGC
GTTAACTGATTTTCAATTATCAAAAGGAATTACGTTTCATGAACAACAGAAAAGAATGGTAACTATGTTTGTAAAGGAAG
TAGAAAATCCACTCTCATTCGGTCTAGTTGTAATGAACAAAGAACAAGAGGTTACACGATATATAGAAAAACCGAGTTGG
AATGAAGTAGTCTCTAATATTGTGAATACAGGTATATATATTATGGAGCCAGAAATTTTTTCTTACATACCGCCCCGAGA
ATTTTTTGATTTCAGTCAAGATGTGTTTCCATTATTGGCAAATAAAAACGCATTATTTGCATATTTATCAGAAGGTTATT
GGTTAGATATCGGCACATTTGATCAATATCGACAAGCCCAATTTGATTTGTTAACAAAAAAATTGCAAGTACCTATTCCT
TATACTGAAGTATTGCCGATGGTATGGATGGGGGAAGGTGTGAAGATTGGAAAAGGCACAAAAATTCACGGCCCTTCTTT
TATTGGAGAGGGAGCAAAAATTGGTGCCGGGGCTGTAATTGAGCCATACTCTATTATCGGGAAAAATAGTATTGTTTCGA
GTTATTCTCATCTTCAAAAAAGTATTGTTTTTGCAAATGCGCACATTGGACAATATTGCGAGTTATTAGAAACGACAATA
GGAGAGCATACAATGGTGGAAGATGACGTTACATTGTTTCAAAAAAGCATTGTAGCAGATCATTGTCATATAGGGAAAAG
TACGGTAATTAAGCAAAAGGGAAAACTATGGCCATATAAGGCGATTGATAGCTATTCGGTAGTAGGATCGGCTGGTGTTC
AAGAAAGTGAAAAGAGCGCCGGATGGCTGCAAAAAAGTCGCATTGTAGGAAGAGGGAACGTTGAAATCACCCCTCAATTT
ATAGTAAAGGTAGCGATGGCGTACGGATCCCTTTTTACCAAAGGGGAAAGTATATTAATCGGGAGCCAAGAACATATAGA
AACGACTTCTTATAAAAATCTTTTTCTTCATGCGATTCATGGTATTGGGATTCATACGATGGAATGCAAAGAAATGAACG
AATCGCTTTTTCAGTATAGCATTCAAGATTTACAATGTGCAGGTGGAGTTTTCATTCAAGTGGAAAATGAAAAAGAAGTT
ATTATAAAGTTGTATGGTCAGGATGGGGCACAATTAACGTATAAGCAGCAAAAAGCGATAGAACAAGTATATATGTCTGA
GTCTTTTTATTACGTATGTGAGAAAGAAATGGGGCGAAATAAGCTGGTCCATGTTTCTTTACATGATTATATAGAGGCTG
TATTAGAGCGCATTGATATTGAGAAAATACAAAAACAGAAGTTCCACCTTCTTATTAATAAGAGAAATGATATGTTACAA
CATTTACTTATGCTTTTTTTGCAAAGGCTTGGATGCACAGTTACGTGGATTTATGCAGGTGAACAGAAGGATCATGTGAA
GGCCTTGATGAAATCAAGTAAAGCGAATATGGCACTCATGTTTTCAGAGCAAGGAAATTATTTTGAGTTATATGATAATC
ATAGTAACATTTACCAGGGGACAGATTTTGAAGAGGTAGATATTCCAGATTTATTACTTGAATCGGCAGGAAATATTTAC
CCAATGTCTTTGAAATTAGGAGAATGTTACCTTCTATTTTATACGCAGGATGAAAAAAAGTCGTTTCAAGCGAGATGGAA
GCGAGATATCCTATATCGAATTGGAAAATTATTTGAGCTAATAGCATTGCAGGGAAAAACATTTCTCAGCATAGTAGAGC
AATCACCTCCGCTCTATTTACTTTGTGATGAAGTTGTATGTTCATGGAATGAAAAAGGGAAAGTGATGAGGAAATTATTG
GCTGATGTGGAAAGAAAGGAAGAAGGTATATTTGAAGGAGTACAGTTCAAATATACCGAAAAAGAGTGGTCTTATATCGT
TTCTGACACAAAACAACCGAAATTTTTAGTGTATTCACATGCTAGAAACCCAGTCATAGCAAGGGAAAACATGAAAAATC
TTATAGAAAAAATTAGACAATATCAAAAGGTGTAG

Upstream 100 bases:

>100_bases
TAATGAAATTTTTATTTTATACTGCTAGTTAATGCTGGGTAGATAATATACATATCGTATATGAAGTTACTGAACATTAT
ATAAGTGGAGGCTGAAGTAT

Downstream 100 bases:

>100_bases
AATTTTTATTTTAAAAGTGGTATTATAGTATAGTCTGATTTAAGTTATTAGTACTGGAGGGAAATAAGAATGCGTGTGAA
TATTACTCTAGCATGTACAG

Product: nucleotidyl transferase family protein

Products: NA

Alternate protein names: UDP-N-acetylglucosamine pyrophosphorylase; N-acetylglucosamine-1-phosphate uridyltransferase; Glucosamine-1-phosphate N-acetyltransferase [H]

Number of amino acids: Translated: 784; Mature: 784

Protein sequence:

>784_residues
MKGVILAGGKGRRLRPLTCNTPKPMLPLLEKPVLEYNIELLRQHGIREIAITVQYMSTAIKQYFGDGSKWGVNLYYFEDS
PPLGTAGSIKQAEKFLDETFVVISGDALTDFQLSKGITFHEQQKRMVTMFVKEVENPLSFGLVVMNKEQEVTRYIEKPSW
NEVVSNIVNTGIYIMEPEIFSYIPPREFFDFSQDVFPLLANKNALFAYLSEGYWLDIGTFDQYRQAQFDLLTKKLQVPIP
YTEVLPMVWMGEGVKIGKGTKIHGPSFIGEGAKIGAGAVIEPYSIIGKNSIVSSYSHLQKSIVFANAHIGQYCELLETTI
GEHTMVEDDVTLFQKSIVADHCHIGKSTVIKQKGKLWPYKAIDSYSVVGSAGVQESEKSAGWLQKSRIVGRGNVEITPQF
IVKVAMAYGSLFTKGESILIGSQEHIETTSYKNLFLHAIHGIGIHTMECKEMNESLFQYSIQDLQCAGGVFIQVENEKEV
IIKLYGQDGAQLTYKQQKAIEQVYMSESFYYVCEKEMGRNKLVHVSLHDYIEAVLERIDIEKIQKQKFHLLINKRNDMLQ
HLLMLFLQRLGCTVTWIYAGEQKDHVKALMKSSKANMALMFSEQGNYFELYDNHSNIYQGTDFEEVDIPDLLLESAGNIY
PMSLKLGECYLLFYTQDEKKSFQARWKRDILYRIGKLFELIALQGKTFLSIVEQSPPLYLLCDEVVCSWNEKGKVMRKLL
ADVERKEEGIFEGVQFKYTEKEWSYIVSDTKQPKFLVYSHARNPVIARENMKNLIEKIRQYQKV

Sequences:

>Translated_784_residues
MKGVILAGGKGRRLRPLTCNTPKPMLPLLEKPVLEYNIELLRQHGIREIAITVQYMSTAIKQYFGDGSKWGVNLYYFEDS
PPLGTAGSIKQAEKFLDETFVVISGDALTDFQLSKGITFHEQQKRMVTMFVKEVENPLSFGLVVMNKEQEVTRYIEKPSW
NEVVSNIVNTGIYIMEPEIFSYIPPREFFDFSQDVFPLLANKNALFAYLSEGYWLDIGTFDQYRQAQFDLLTKKLQVPIP
YTEVLPMVWMGEGVKIGKGTKIHGPSFIGEGAKIGAGAVIEPYSIIGKNSIVSSYSHLQKSIVFANAHIGQYCELLETTI
GEHTMVEDDVTLFQKSIVADHCHIGKSTVIKQKGKLWPYKAIDSYSVVGSAGVQESEKSAGWLQKSRIVGRGNVEITPQF
IVKVAMAYGSLFTKGESILIGSQEHIETTSYKNLFLHAIHGIGIHTMECKEMNESLFQYSIQDLQCAGGVFIQVENEKEV
IIKLYGQDGAQLTYKQQKAIEQVYMSESFYYVCEKEMGRNKLVHVSLHDYIEAVLERIDIEKIQKQKFHLLINKRNDMLQ
HLLMLFLQRLGCTVTWIYAGEQKDHVKALMKSSKANMALMFSEQGNYFELYDNHSNIYQGTDFEEVDIPDLLLESAGNIY
PMSLKLGECYLLFYTQDEKKSFQARWKRDILYRIGKLFELIALQGKTFLSIVEQSPPLYLLCDEVVCSWNEKGKVMRKLL
ADVERKEEGIFEGVQFKYTEKEWSYIVSDTKQPKFLVYSHARNPVIARENMKNLIEKIRQYQKV
>Mature_784_residues
MKGVILAGGKGRRLRPLTCNTPKPMLPLLEKPVLEYNIELLRQHGIREIAITVQYMSTAIKQYFGDGSKWGVNLYYFEDS
PPLGTAGSIKQAEKFLDETFVVISGDALTDFQLSKGITFHEQQKRMVTMFVKEVENPLSFGLVVMNKEQEVTRYIEKPSW
NEVVSNIVNTGIYIMEPEIFSYIPPREFFDFSQDVFPLLANKNALFAYLSEGYWLDIGTFDQYRQAQFDLLTKKLQVPIP
YTEVLPMVWMGEGVKIGKGTKIHGPSFIGEGAKIGAGAVIEPYSIIGKNSIVSSYSHLQKSIVFANAHIGQYCELLETTI
GEHTMVEDDVTLFQKSIVADHCHIGKSTVIKQKGKLWPYKAIDSYSVVGSAGVQESEKSAGWLQKSRIVGRGNVEITPQF
IVKVAMAYGSLFTKGESILIGSQEHIETTSYKNLFLHAIHGIGIHTMECKEMNESLFQYSIQDLQCAGGVFIQVENEKEV
IIKLYGQDGAQLTYKQQKAIEQVYMSESFYYVCEKEMGRNKLVHVSLHDYIEAVLERIDIEKIQKQKFHLLINKRNDMLQ
HLLMLFLQRLGCTVTWIYAGEQKDHVKALMKSSKANMALMFSEQGNYFELYDNHSNIYQGTDFEEVDIPDLLLESAGNIY
PMSLKLGECYLLFYTQDEKKSFQARWKRDILYRIGKLFELIALQGKTFLSIVEQSPPLYLLCDEVVCSWNEKGKVMRKLL
ADVERKEEGIFEGVQFKYTEKEWSYIVSDTKQPKFLVYSHARNPVIARENMKNLIEKIRQYQKV

Specific function: Catalyzes the last two sequential reactions in the de novo biosynthetic pathway for UDP-N-acetyl-glucosamine (UDP- GlcNAc). Responsible for the acetylation of GlcN-1-P to GlcNAc-1- P, and for the uridyl transfer from UTP to GlcNAc-1-P, to produce UDP-GlcN

COG id: COG1208

COG function: function code MJ; Nucleoside-diphosphate-sugar pyrophosphorylase involved in lipopolysaccharide biosynthesis/translation initiation factor 2B, gamma/epsilon subunits (eIF-2Bgamma/eIF-2Bepsilon)

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: In the C-terminal section; belongs to the transferase hexapeptide repeat family [H]

Homologues:

Organism=Homo sapiens, GI11761621, Length=366, Percent_Identity=29.7814207650273, Blast_Score=162, Evalue=9e-40,
Organism=Homo sapiens, GI11761619, Length=386, Percent_Identity=27.979274611399, Blast_Score=154, Evalue=3e-37,
Organism=Homo sapiens, GI31881779, Length=359, Percent_Identity=28.4122562674095, Blast_Score=116, Evalue=1e-25,
Organism=Homo sapiens, GI45447090, Length=359, Percent_Identity=28.4122562674095, Blast_Score=116, Evalue=1e-25,
Organism=Escherichia coli, GI1788351, Length=227, Percent_Identity=31.2775330396476, Blast_Score=93, Evalue=6e-20,
Organism=Escherichia coli, GI1790224, Length=235, Percent_Identity=31.9148936170213, Blast_Score=92, Evalue=1e-19,
Organism=Escherichia coli, GI1789837, Length=383, Percent_Identity=20.88772845953, Blast_Score=84, Evalue=2e-17,
Organism=Caenorhabditis elegans, GI133931050, Length=353, Percent_Identity=29.4617563739377, Blast_Score=153, Evalue=4e-37,
Organism=Caenorhabditis elegans, GI17509979, Length=339, Percent_Identity=26.8436578171091, Blast_Score=100, Evalue=4e-21,
Organism=Caenorhabditis elegans, GI17509981, Length=329, Percent_Identity=25.8358662613982, Blast_Score=91, Evalue=2e-18,
Organism=Saccharomyces cerevisiae, GI6320148, Length=374, Percent_Identity=28.0748663101604, Blast_Score=159, Evalue=1e-39,
Organism=Drosophila melanogaster, GI21355443, Length=354, Percent_Identity=32.2033898305085, Blast_Score=162, Evalue=8e-40,
Organism=Drosophila melanogaster, GI24644084, Length=354, Percent_Identity=32.2033898305085, Blast_Score=162, Evalue=8e-40,
Organism=Drosophila melanogaster, GI24653912, Length=372, Percent_Identity=27.4193548387097, Blast_Score=117, Evalue=3e-26,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR005835
- InterPro:   IPR011004 [H]

Pfam domain/function: PF00483 NTP_transferase [H]

EC number: =2.7.7.23; =2.3.1.157 [H]

Molecular weight: Translated: 89684; Mature: 89684

Theoretical pI: Translated: 6.83; Mature: 6.83

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.3 %Cys     (Translated Protein)
2.9 %Met     (Translated Protein)
4.2 %Cys+Met (Translated Protein)
1.3 %Cys     (Mature Protein)
2.9 %Met     (Mature Protein)
4.2 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKGVILAGGKGRRLRPLTCNTPKPMLPLLEKPVLEYNIELLRQHGIREIAITVQYMSTAI
CCCEEEECCCCCEECCEECCCCCCCHHHHHCCHHHHHHHHHHHCCCEEEEEHHHHHHHHH
KQYFGDGSKWGVNLYYFEDSPPLGTAGSIKQAEKFLDETFVVISGDALTDFQLSKGITFH
HHHHCCCCCEEEEEEEEECCCCCCCCCCHHHHHHHHCCEEEEEECCCEECCHHHCCCCHH
EQQKRMVTMFVKEVENPLSFGLVVMNKEQEVTRYIEKPSWNEVVSNIVNTGIYIMEPEIF
HHHHHHHHHHHHHHCCCHHEEEEEECCHHHHHHHHCCCCHHHHHHHHHHCCEEEECCHHH
SYIPPREFFDFSQDVFPLLANKNALFAYLSEGYWLDIGTFDQYRQAQFDLLTKKLQVPIP
HCCCCHHHHCCCCHHHHHHCCCCEEEEEECCCEEEEECCHHHHHHHHHHHHHHHHCCCCC
YTEVLPMVWMGEGVKIGKGTKIHGPSFIGEGAKIGAGAVIEPYSIIGKNSIVSSYSHLQK
HHHHHHHHCCCCCEEECCCCEECCCCCCCCCCCCCCCCEECCHHHHCCHHHHHHHHHHHH
SIVFANAHIGQYCELLETTIGEHTMVEDDVTLFQKSIVADHCHIGKSTVIKQKGKLWPYK
HHEEECCCHHHHHHHHHHHCCCCEEEHHHHHHHHHHHHHHHHCCCCHHHHHCCCCCCCCC
AIDSYSVVGSAGVQESEKSAGWLQKSRIVGRGNVEITPQFIVKVAMAYGSLFTKGESILI
CCCCEEECCCCCCCCCHHHHCHHHHHCEEECCCCEECHHHHHHHHHHHHHHHCCCCEEEE
GSQEHIETTSYKNLFLHAIHGIGIHTMECKEMNESLFQYSIQDLQCAGGVFIQVENEKEV
CCHHHCCHHHHHHHHHHHHHCCCEEEEHHHHHHHHHHHHHHHHHHCCCCEEEEECCCCEE
IIKLYGQDGAQLTYKQQKAIEQVYMSESFYYVCEKEMGRNKLVHVSLHDYIEAVLERIDI
EEEEECCCCCEEEHHHHHHHHHHHHCCCEEEEEEHHCCCCCEEEEEHHHHHHHHHHHHCH
EKIQKQKFHLLINKRNDMLQHLLMLFLQRLGCTVTWIYAGEQKDHVKALMKSSKANMALM
HHHHHHHEEEEEECHHHHHHHHHHHHHHHCCCEEEEEEECCCHHHHHHHHHCCCCCEEEE
FSEQGNYFELYDNHSNIYQGTDFEEVDIPDLLLESAGNIYPMSLKLGECYLLFYTQDEKK
EECCCCEEEEECCCCCCCCCCCCCCCCCHHHHHHCCCCEEEEEEEECCEEEEEEECCHHH
SFQARWKRDILYRIGKLFELIALQGKTFLSIVEQSPPLYLLCDEVVCSWNEKGKVMRKLL
HHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHCCCCEEEEECHHHHCCCCCHHHHHHHH
ADVERKEEGIFEGVQFKYTEKEWSYIVSDTKQPKFLVYSHARNPVIARENMKNLIEKIRQ
HHHHHHHHHHHCCCEEEEECCHHHHEECCCCCCEEEEEECCCCCEEEHHHHHHHHHHHHH
YQKV
HHCC
>Mature Secondary Structure
MKGVILAGGKGRRLRPLTCNTPKPMLPLLEKPVLEYNIELLRQHGIREIAITVQYMSTAI
CCCEEEECCCCCEECCEECCCCCCCHHHHHCCHHHHHHHHHHHCCCEEEEEHHHHHHHHH
KQYFGDGSKWGVNLYYFEDSPPLGTAGSIKQAEKFLDETFVVISGDALTDFQLSKGITFH
HHHHCCCCCEEEEEEEEECCCCCCCCCCHHHHHHHHCCEEEEEECCCEECCHHHCCCCHH
EQQKRMVTMFVKEVENPLSFGLVVMNKEQEVTRYIEKPSWNEVVSNIVNTGIYIMEPEIF
HHHHHHHHHHHHHHCCCHHEEEEEECCHHHHHHHHCCCCHHHHHHHHHHCCEEEECCHHH
SYIPPREFFDFSQDVFPLLANKNALFAYLSEGYWLDIGTFDQYRQAQFDLLTKKLQVPIP
HCCCCHHHHCCCCHHHHHHCCCCEEEEEECCCEEEEECCHHHHHHHHHHHHHHHHCCCCC
YTEVLPMVWMGEGVKIGKGTKIHGPSFIGEGAKIGAGAVIEPYSIIGKNSIVSSYSHLQK
HHHHHHHHCCCCCEEECCCCEECCCCCCCCCCCCCCCCEECCHHHHCCHHHHHHHHHHHH
SIVFANAHIGQYCELLETTIGEHTMVEDDVTLFQKSIVADHCHIGKSTVIKQKGKLWPYK
HHEEECCCHHHHHHHHHHHCCCCEEEHHHHHHHHHHHHHHHHCCCCHHHHHCCCCCCCCC
AIDSYSVVGSAGVQESEKSAGWLQKSRIVGRGNVEITPQFIVKVAMAYGSLFTKGESILI
CCCCEEECCCCCCCCCHHHHCHHHHHCEEECCCCEECHHHHHHHHHHHHHHHCCCCEEEE
GSQEHIETTSYKNLFLHAIHGIGIHTMECKEMNESLFQYSIQDLQCAGGVFIQVENEKEV
CCHHHCCHHHHHHHHHHHHHCCCEEEEHHHHHHHHHHHHHHHHHHCCCCEEEEECCCCEE
IIKLYGQDGAQLTYKQQKAIEQVYMSESFYYVCEKEMGRNKLVHVSLHDYIEAVLERIDI
EEEEECCCCCEEEHHHHHHHHHHHHCCCEEEEEEHHCCCCCEEEEEHHHHHHHHHHHHCH
EKIQKQKFHLLINKRNDMLQHLLMLFLQRLGCTVTWIYAGEQKDHVKALMKSSKANMALM
HHHHHHHEEEEEECHHHHHHHHHHHHHHHCCCEEEEEEECCCHHHHHHHHHCCCCCEEEE
FSEQGNYFELYDNHSNIYQGTDFEEVDIPDLLLESAGNIYPMSLKLGECYLLFYTQDEKK
EECCCCEEEEECCCCCCCCCCCCCCCCCHHHHHHCCCCEEEEEEEECCEEEEEEECCHHH
SFQARWKRDILYRIGKLFELIALQGKTFLSIVEQSPPLYLLCDEVVCSWNEKGKVMRKLL
HHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHCCCCEEEEECHHHHCCCCCHHHHHHHH
ADVERKEEGIFEGVQFKYTEKEWSYIVSDTKQPKFLVYSHARNPVIARENMKNLIEKIRQ
HHHHHHHHHHHCCCEEEEECCHHHHEECCCCCCEEEEEECCCCCEEEHHHHHHHHHHHHH
YQKV
HHCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 8688087 [H]