Definition Wolbachia sp. wRi, complete genome.
Accession NC_012416
Length 1,445,873

Click here to switch to the map view.

The map label for this gene is glmS [H]

Identifier: 225630159

GI number: 225630159

Start: 372622

End: 374433

Strand: Direct

Name: glmS [H]

Synonym: WRi_003490

Alternate gene names: 225630159

Gene position: 372622-374433 (Clockwise)

Preceding gene: 225630158

Following gene: 225630160

Centisome position: 25.77

GC content: 37.47

Gene sequence:

>1812_bases
GTGTGTGGAATATTTGGTGTAGTAAGTAGCGGTGATTCAGTAATACCAACTTTACTAACTGGGTTGCAAAAATTGGAATA
TAGGGGATATGACTCTTCAGGTATAGCAATCATAAACAACGAAGGTAAGATAGAAGTCAAAAAATCAGAAGGTAAAGTCG
AAAGGTTATGTGAAGTTGTTGATGACAGCAAGATGTCTCACAGTACAGTTGGTATAGCACATACTCGCTGGGCTACACAT
GGAGTTCCAGGCCTTAAAAATGCTCACCCCATTCGTACAAATAACGTTGTTGTTGCTCATAACGGCATAATTGAGAATTA
CAATCTGCTAAAAAAGGGTCTAGAAGAAAGGGGAATGCCATTCCATACTGACACTGACACAGAGATCATACCAAACATGC
TAACCTTATATCTTGATGAAGGATTGTCGCCAATTGATTCTCTATTTAAGTGTTTAAACAACTTACATGGCTCATTTGCC
TTGGTCTTATTATTTGCAGAATATCCAGACGCCTTATTTGTTGCGAAGAGAAATTTGCCTTTAGCAATAGGCTATAACTG
TAACACAGTGTTTGCTGCATCTGACTCTAATGCTTTAAGTGCATTTGTGGAAAGAATATCGCATTTGGAAGATGATGACA
TTGCAGTGATAAAATCTAGTGGAGTTAGTATATACAACAATGGTACACAAGTTAAACGCAGTATAGAAAATAGTAGTCCA
AGTGATTTTCTAATTAGCAAAAATGGTTACCCTAGCTTCATGTTAAAAGAGATTTTTGAGCAACCTTGTGCATTAAACAA
AACAATAAACCAATTTTACAAGCAATATAAAGAGGTCAACAAAAAATTATTCTCTGAACTGAATCACATTACTATAGTTG
GATGCGGATCATCTTATTTTGCTGGGCTAATAGCGAAGTATTGGCTGGAAAGTGTCGCTCAAGTTCGAGTATATCTAGAA
ATCTCGTCAGAATTTAGGTATAGCAACGTCAAGCTAGAAGAAGGCAGCATTGGGTTATTCATCTCTCAATCTGGCGAAAC
TGCAGATACCATAGAAGCGCTGCGTTATGCGAAATCACAGAAGCAAACAATCATTAGTATAACTAATACATTTAGCAGCA
GCATTGAAAAGATCTCAGATATTGTGTTACATACTCTTGCTGGGCCAGAAATTGGTGTTGCTTCAACAAAAACCTTCTCT
GCACAACTTGCAACTTTAGCATGCTTTGTCGTGGAGCTTGGAAAAATAAAAGGTGTACTGGGTGGAGAGAGAATAAAACA
GCTAAGCAACGCTATCAACTCTATTCCCAAGCATGTTGAGCATGTTTTAAATGTGATGAAAATACAACATATATCAGGCA
GTATATTAGAACACAATAACGTTATTTTAATTGGCAGAGGAAGCTCATATGGAGTTGCAATGGAAGGTGCATTGAAGATA
AAAGAGCTTTCATACATCAATACCATTGGTATTGCAGCGGGAGAAATGAAGCACGGTTCTATTGCTTTAATAGACTCTAC
TGTGCTTGTTATAGCAATTATCCCTTATGATAGTTTATTCTTTAAAACGCTATCTAATATACAAGAGATTATTGCAAGAA
AAGGCAAAGTAATTGCCTTCAGTGATAAGCAAGGAGCGCCATTCCTAAGGGAAGTTTGCGCAGATGTGGTGCAACTTCCA
GACGCTGATAATTTTATCTCTCCAATCATCTACAGTGTTGCTATGCAATTCCTTGCTTACTTTACTGCAGCAAAAAAAGG
GTTAGACGTGGATTGTCCGAGAAATTTAGCCAAGTCTGTTACGGTTGAGTAG

Upstream 100 bases:

>100_bases
AGGTAAAATCGAAAGAATGATAAAAAGAATATAAATCAACCAGTAATAAAGGCAAAAATGCTTAACATGTTTAGAAAAAA
GTTTGTTTGGTGATCCATTT

Downstream 100 bases:

>100_bases
TCCATTTAAAGTTAAAGCTAAACTTCTAATAAGGTAACCAGACTGCATTCTGTGATTTTTAGCAAAACACGATACACAAT
CGTCATTCCGCTACTAATTA

Product: glucosamine--fructose-6-phosphate aminotransferase (isomerizing)

Products: NA

Alternate protein names: D-fructose-6-phosphate amidotransferase; GFAT; Glucosamine-6-phosphate synthase; Hexosephosphate aminotransferase; L-glutamine-D-fructose-6-phosphate amidotransferase [H]

Number of amino acids: Translated: 603; Mature: 603

Protein sequence:

>603_residues
MCGIFGVVSSGDSVIPTLLTGLQKLEYRGYDSSGIAIINNEGKIEVKKSEGKVERLCEVVDDSKMSHSTVGIAHTRWATH
GVPGLKNAHPIRTNNVVVAHNGIIENYNLLKKGLEERGMPFHTDTDTEIIPNMLTLYLDEGLSPIDSLFKCLNNLHGSFA
LVLLFAEYPDALFVAKRNLPLAIGYNCNTVFAASDSNALSAFVERISHLEDDDIAVIKSSGVSIYNNGTQVKRSIENSSP
SDFLISKNGYPSFMLKEIFEQPCALNKTINQFYKQYKEVNKKLFSELNHITIVGCGSSYFAGLIAKYWLESVAQVRVYLE
ISSEFRYSNVKLEEGSIGLFISQSGETADTIEALRYAKSQKQTIISITNTFSSSIEKISDIVLHTLAGPEIGVASTKTFS
AQLATLACFVVELGKIKGVLGGERIKQLSNAINSIPKHVEHVLNVMKIQHISGSILEHNNVILIGRGSSYGVAMEGALKI
KELSYINTIGIAAGEMKHGSIALIDSTVLVIAIIPYDSLFFKTLSNIQEIIARKGKVIAFSDKQGAPFLREVCADVVQLP
DADNFISPIIYSVAMQFLAYFTAAKKGLDVDCPRNLAKSVTVE

Sequences:

>Translated_603_residues
MCGIFGVVSSGDSVIPTLLTGLQKLEYRGYDSSGIAIINNEGKIEVKKSEGKVERLCEVVDDSKMSHSTVGIAHTRWATH
GVPGLKNAHPIRTNNVVVAHNGIIENYNLLKKGLEERGMPFHTDTDTEIIPNMLTLYLDEGLSPIDSLFKCLNNLHGSFA
LVLLFAEYPDALFVAKRNLPLAIGYNCNTVFAASDSNALSAFVERISHLEDDDIAVIKSSGVSIYNNGTQVKRSIENSSP
SDFLISKNGYPSFMLKEIFEQPCALNKTINQFYKQYKEVNKKLFSELNHITIVGCGSSYFAGLIAKYWLESVAQVRVYLE
ISSEFRYSNVKLEEGSIGLFISQSGETADTIEALRYAKSQKQTIISITNTFSSSIEKISDIVLHTLAGPEIGVASTKTFS
AQLATLACFVVELGKIKGVLGGERIKQLSNAINSIPKHVEHVLNVMKIQHISGSILEHNNVILIGRGSSYGVAMEGALKI
KELSYINTIGIAAGEMKHGSIALIDSTVLVIAIIPYDSLFFKTLSNIQEIIARKGKVIAFSDKQGAPFLREVCADVVQLP
DADNFISPIIYSVAMQFLAYFTAAKKGLDVDCPRNLAKSVTVE
>Mature_603_residues
MCGIFGVVSSGDSVIPTLLTGLQKLEYRGYDSSGIAIINNEGKIEVKKSEGKVERLCEVVDDSKMSHSTVGIAHTRWATH
GVPGLKNAHPIRTNNVVVAHNGIIENYNLLKKGLEERGMPFHTDTDTEIIPNMLTLYLDEGLSPIDSLFKCLNNLHGSFA
LVLLFAEYPDALFVAKRNLPLAIGYNCNTVFAASDSNALSAFVERISHLEDDDIAVIKSSGVSIYNNGTQVKRSIENSSP
SDFLISKNGYPSFMLKEIFEQPCALNKTINQFYKQYKEVNKKLFSELNHITIVGCGSSYFAGLIAKYWLESVAQVRVYLE
ISSEFRYSNVKLEEGSIGLFISQSGETADTIEALRYAKSQKQTIISITNTFSSSIEKISDIVLHTLAGPEIGVASTKTFS
AQLATLACFVVELGKIKGVLGGERIKQLSNAINSIPKHVEHVLNVMKIQHISGSILEHNNVILIGRGSSYGVAMEGALKI
KELSYINTIGIAAGEMKHGSIALIDSTVLVIAIIPYDSLFFKTLSNIQEIIARKGKVIAFSDKQGAPFLREVCADVVQLP
DADNFISPIIYSVAMQFLAYFTAAKKGLDVDCPRNLAKSVTVE

Specific function: Catalyzes the first step in hexosamine metabolism, converting fructose-6P into glucosamine-6P using glutamine as a nitrogen source [H]

COG id: COG0449

COG function: function code M; Glucosamine 6-phosphate synthetase, contains amidotransferase and phosphosugar isomerase domains

Gene ontology:

Cell location: Cytoplasm [H]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 2 SIS domains [H]

Homologues:

Organism=Homo sapiens, GI4826742, Length=694, Percent_Identity=35.1585014409222, Blast_Score=369, Evalue=1e-102,
Organism=Homo sapiens, GI205277386, Length=684, Percent_Identity=33.6257309941521, Blast_Score=363, Evalue=1e-100,
Organism=Homo sapiens, GI29570798, Length=198, Percent_Identity=28.7878787878788, Blast_Score=68, Evalue=2e-11,
Organism=Escherichia coli, GI1790167, Length=613, Percent_Identity=40.1305057096248, Blast_Score=441, Evalue=1e-125,
Organism=Escherichia coli, GI1788651, Length=146, Percent_Identity=30.8219178082192, Blast_Score=66, Evalue=6e-12,
Organism=Caenorhabditis elegans, GI17532899, Length=427, Percent_Identity=33.7236533957845, Blast_Score=241, Evalue=7e-64,
Organism=Caenorhabditis elegans, GI17532897, Length=427, Percent_Identity=33.7236533957845, Blast_Score=241, Evalue=9e-64,
Organism=Caenorhabditis elegans, GI17539970, Length=431, Percent_Identity=33.6426914153132, Blast_Score=240, Evalue=2e-63,
Organism=Saccharomyces cerevisiae, GI6322745, Length=433, Percent_Identity=33.256351039261, Blast_Score=233, Evalue=6e-62,
Organism=Saccharomyces cerevisiae, GI6323731, Length=427, Percent_Identity=28.3372365339578, Blast_Score=166, Evalue=1e-41,
Organism=Saccharomyces cerevisiae, GI6323730, Length=231, Percent_Identity=36.7965367965368, Blast_Score=116, Evalue=8e-27,
Organism=Saccharomyces cerevisiae, GI6323958, Length=148, Percent_Identity=31.7567567567568, Blast_Score=66, Evalue=1e-11,
Organism=Drosophila melanogaster, GI21357745, Length=691, Percent_Identity=33.4298118668596, Blast_Score=370, Evalue=1e-102,
Organism=Drosophila melanogaster, GI28573187, Length=205, Percent_Identity=31.219512195122, Blast_Score=72, Evalue=1e-12,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR000583
- InterPro:   IPR017932
- InterPro:   IPR005855
- InterPro:   IPR001347 [H]

Pfam domain/function: PF00310 GATase_2; PF01380 SIS [H]

EC number: =2.6.1.16 [H]

Molecular weight: Translated: 65911; Mature: 65911

Theoretical pI: Translated: 6.79; Mature: 6.79

Prosite motif: PS00443 GATASE_TYPE_II

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.5 %Cys     (Translated Protein)
1.5 %Met     (Translated Protein)
3.0 %Cys+Met (Translated Protein)
1.5 %Cys     (Mature Protein)
1.5 %Met     (Mature Protein)
3.0 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MCGIFGVVSSGDSVIPTLLTGLQKLEYRGYDSSGIAIINNEGKIEVKKSEGKVERLCEVV
CCCEEEEECCCCCHHHHHHHHHHHHHCCCCCCCCEEEEECCCEEEEECCCCHHHHHHHHH
DDSKMSHSTVGIAHTRWATHGVPGLKNAHPIRTNNVVVAHNGIIENYNLLKKGLEERGMP
CCCCCCCCEECEEEECHHHCCCCCCCCCCCCCCCCEEEEECCCCCCHHHHHHHHHHCCCC
FHTDTDTEIIPNMLTLYLDEGLSPIDSLFKCLNNLHGSFALVLLFAEYPDALFVAKRNLP
CCCCCCHHHHHHHHHHHHHCCCCHHHHHHHHHHHCCCHHEEEEHHHCCCCEEEEEECCCC
LAIGYNCNTVFAASDSNALSAFVERISHLEDDDIAVIKSSGVSIYNNGTQVKRSIENSSP
EEEECCCCEEEEECCCHHHHHHHHHHHCCCCCCEEEEECCCEEEEECCHHHHHHHCCCCC
SDFLISKNGYPSFMLKEIFEQPCALNKTINQFYKQYKEVNKKLFSELNHITIVGCGSSYF
CCEEEECCCCCHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHCCCCEEEEECCHHHH
AGLIAKYWLESVAQVRVYLEISSEFRYSNVKLEEGSIGLFISQSGETADTIEALRYAKSQ
HHHHHHHHHHHHHHEEEEEEECCCCCCCEEEEECCCEEEEEECCCCCHHHHHHHHHHHHC
KQTIISITNTFSSSIEKISDIVLHTLAGPEIGVASTKTFSAQLATLACFVVELGKIKGVL
CCEEEEEHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHCCC
GGERIKQLSNAINSIPKHVEHVLNVMKIQHISGSILEHNNVILIGRGSSYGVAMEGALKI
CHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEECCCEEEEECCCCCCEEECCCEEE
KELSYINTIGIAAGEMKHGSIALIDSTVLVIAIIPYDSLFFKTLSNIQEIIARKGKVIAF
HHHHHHHHHCCCCCCCCCCCEEEEECCEEEEEEECCHHHHHHHHHHHHHHHHCCCCEEEE
SDKQGAPFLREVCADVVQLPDADNFISPIIYSVAMQFLAYFTAAKKGLDVDCPRNLAKSV
ECCCCCHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHHCC
TVE
CCC
>Mature Secondary Structure
MCGIFGVVSSGDSVIPTLLTGLQKLEYRGYDSSGIAIINNEGKIEVKKSEGKVERLCEVV
CCCEEEEECCCCCHHHHHHHHHHHHHCCCCCCCCEEEEECCCEEEEECCCCHHHHHHHHH
DDSKMSHSTVGIAHTRWATHGVPGLKNAHPIRTNNVVVAHNGIIENYNLLKKGLEERGMP
CCCCCCCCEECEEEECHHHCCCCCCCCCCCCCCCCEEEEECCCCCCHHHHHHHHHHCCCC
FHTDTDTEIIPNMLTLYLDEGLSPIDSLFKCLNNLHGSFALVLLFAEYPDALFVAKRNLP
CCCCCCHHHHHHHHHHHHHCCCCHHHHHHHHHHHCCCHHEEEEHHHCCCCEEEEEECCCC
LAIGYNCNTVFAASDSNALSAFVERISHLEDDDIAVIKSSGVSIYNNGTQVKRSIENSSP
EEEECCCCEEEEECCCHHHHHHHHHHHCCCCCCEEEEECCCEEEEECCHHHHHHHCCCCC
SDFLISKNGYPSFMLKEIFEQPCALNKTINQFYKQYKEVNKKLFSELNHITIVGCGSSYF
CCEEEECCCCCHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHCCCCEEEEECCHHHH
AGLIAKYWLESVAQVRVYLEISSEFRYSNVKLEEGSIGLFISQSGETADTIEALRYAKSQ
HHHHHHHHHHHHHHEEEEEEECCCCCCCEEEEECCCEEEEEECCCCCHHHHHHHHHHHHC
KQTIISITNTFSSSIEKISDIVLHTLAGPEIGVASTKTFSAQLATLACFVVELGKIKGVL
CCEEEEEHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHCCC
GGERIKQLSNAINSIPKHVEHVLNVMKIQHISGSILEHNNVILIGRGSSYGVAMEGALKI
CHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEECCCEEEEECCCCCCEEECCCEEE
KELSYINTIGIAAGEMKHGSIALIDSTVLVIAIIPYDSLFFKTLSNIQEIIARKGKVIAF
HHHHHHHHHCCCCCCCCCCCEEEEECCEEEEEEECCHHHHHHHHHHHHHHHHCCCCEEEE
SDKQGAPFLREVCADVVQLPDADNFISPIIYSVAMQFLAYFTAAKKGLDVDCPRNLAKSV
ECCCCCHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHHCC
TVE
CCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA