The gene/protein map for NC_009921 is currently unavailable.
Definition Frankia sp. EAN1pec chromosome, complete genome.
Accession NC_009921
Length 8,982,042

Click here to switch to the map view.

The map label for this gene is wecB [H]

Identifier: 158316958

GI number: 158316958

Start: 6244734

End: 6246488

Strand: Reverse

Name: wecB [H]

Synonym: Franean1_5202

Alternate gene names: 158316958

Gene position: 6246488-6244734 (Counterclockwise)

Preceding gene: 158316959

Following gene: 158316956

Centisome position: 69.54

GC content: 72.48

Gene sequence:

>1755_bases
ATGGGGGTGTCCCACCGGATACCGGCGGCCAGGCCCAGGCCGCAGACCGGCCACACCGCGACCTCTCCCAACACGACCGG
GCTGGACGACGGCGGTGCCGGCGGTCAGACCGTGCCCGGTCAGGGCGCCAGGGGCCAGAGCATTCCCGGCCAGGGTGCCG
GCGGGCCGGGTGTCCCAGGTCAGGGTGCCGGCGGGCCGGGCGTCGGGGCCCAGGGCGTCGGTGGTCAGAACGTCGGTGGT
CAGGGCGCCGAGGAACAGAACGTCGCGGACCAGGGCGCCGCGGGAGAGAGCACCGCCGGGTGGGGGCCGGCGGAACGAGG
AGGAATGACCGCAATGACCGGGACGGCGGGAACGACCGCACGAACAGGTCCCTCTGTGCCGACCGCGCCGTCCACGCCGA
TCGCCCCGACCGGGCCGACCGTTCCCACGGTCCCGAACCGGCGCCTCCCCCCGGACCGCCAGGGCGCGGCCGGCCGGATG
ACCATGCCCGACCGGGTGCCGCGCACGGAGATCATGGGAGTTCCCGCGCCGGTGCCGCGCGGCCGACCCGGGCCGGCCGA
GCACCGGGCGCGGGTCATGATCCTGGTCGGCACCCGTCCGGAGATCGTGAAGCTGAGCCGAATCATCGCGGCGCTCGAGC
GGGCCGTGGACGTCTGCCTGGTCCACTCGGGCCAGCACTATGACTACGAGCTGAACCAGGTGTTCTTCGACGAGCTCGGT
ATCCGCAAACCGGACCACTTCCTCGACGCTGTCGGCGCGAGCGCCGCCGAGACCATCGGCCGGGTGATCGCCCGCTCCGA
CGCGGTGTTCGTCGACGAGTCCCCGGACGCGCTGCTGCTCTACGGGGACACGAACACCACGCTCGCGGTCATTGCGGCCC
GGCGGCGGCACATCCCGGTGTTCCACCTGGAGGCCGGGAACCGCTGTTTCGACGACCGGGTCCCGGAGGAGATCAACCGC
CGGCTGGTCGACCACCTCAGCGACATCAACCTCCCGCTCACCGAGCACGCGCGGCGCCACCTGCTGGCCGAGGGCCTGCC
GGCGCAGCGGATCTTCGTCACGGGCTCGCCGATGAAGGAGGTCCTCGACCACTACGCGCCGCTCGTCGACGCCTCACCAG
TGCTCACGAACCTCGGTGTCACCGCGGGCCACTTCCTGGTGGTCAGCGCGCACCGGGAGGAGAACGTCGACGCGCCGGAG
CTGCTCATCGGCCTGCTGGAGACACTCAACGCGCTGGCCGCCCGCTACCGGGTGCCGATCATCGTCTCCACCCACCCGCG
TACCCGGGATCGTCTCGACGCCCTTGAGGCGTCCGGCCGCGCCCCTGCGACCGACGGCCTCGTCCGTTTCTGCCGGCCCT
TCGGGTTCGCGGACTACATCGCGTTGCAGCGGGCGGCGCAGTGCGTGATCTCGGACAGCGGCTCGCTGACCGAGGAGGCC
TCGCTGCTCGGGTTCCCCGCGGTGATGATCCGGGAGGCGCACGAGCGCCCTGAGGGCGTCGACCACGGAGTGGCGGTCTC
CTGCCTGCCCCGGCCGGACCGGGTCCTCGCCGCGGTCGACCTGGTCGTCGACGCGGCGCAGGGGGACCGGGCACCGCGGA
TCGTCCCCGATTACGACGTGGACGACGTCTCCCGCCGCGTCGTACGGATCATCGTCAGCCACATCGACTACGTCCGCCGC
ACCGTCTGGTTCGAGCGCCCACCAGTCGGGACCAGCGAACCAACGCCCGGAGGCACCTCCCTGACCCTCCCGTAG

Upstream 100 bases:

>100_bases
TGGCGGGGACGTCCGGCGTGATTCCGACGTGCGGCGTGACCCGGATGCCCGGCGTGATGCGGACGTCCGGCGTGATCCAG
GTGTCGCCGGGGAGCCCGAC

Downstream 100 bases:

>100_bases
CCCAGCCCAGCCCAGCCCAGCCCAGCCCAGCCCAGCCCCTGGCCCGGCTGGGCCGGGGTCAGGCGGGCCAGGGCCGCATC
GCGGAGCCGGAAGCGGGGCC

Product: UDP-N-acetylglucosamine 2-epimerase

Products: NA

Alternate protein names: UDP-GlcNAc-2-epimerase [H]

Number of amino acids: Translated: 584; Mature: 583

Protein sequence:

>584_residues
MGVSHRIPAARPRPQTGHTATSPNTTGLDDGGAGGQTVPGQGARGQSIPGQGAGGPGVPGQGAGGPGVGAQGVGGQNVGG
QGAEEQNVADQGAAGESTAGWGPAERGGMTAMTGTAGTTARTGPSVPTAPSTPIAPTGPTVPTVPNRRLPPDRQGAAGRM
TMPDRVPRTEIMGVPAPVPRGRPGPAEHRARVMILVGTRPEIVKLSRIIAALERAVDVCLVHSGQHYDYELNQVFFDELG
IRKPDHFLDAVGASAAETIGRVIARSDAVFVDESPDALLLYGDTNTTLAVIAARRRHIPVFHLEAGNRCFDDRVPEEINR
RLVDHLSDINLPLTEHARRHLLAEGLPAQRIFVTGSPMKEVLDHYAPLVDASPVLTNLGVTAGHFLVVSAHREENVDAPE
LLIGLLETLNALAARYRVPIIVSTHPRTRDRLDALEASGRAPATDGLVRFCRPFGFADYIALQRAAQCVISDSGSLTEEA
SLLGFPAVMIREAHERPEGVDHGVAVSCLPRPDRVLAAVDLVVDAAQGDRAPRIVPDYDVDDVSRRVVRIIVSHIDYVRR
TVWFERPPVGTSEPTPGGTSLTLP

Sequences:

>Translated_584_residues
MGVSHRIPAARPRPQTGHTATSPNTTGLDDGGAGGQTVPGQGARGQSIPGQGAGGPGVPGQGAGGPGVGAQGVGGQNVGG
QGAEEQNVADQGAAGESTAGWGPAERGGMTAMTGTAGTTARTGPSVPTAPSTPIAPTGPTVPTVPNRRLPPDRQGAAGRM
TMPDRVPRTEIMGVPAPVPRGRPGPAEHRARVMILVGTRPEIVKLSRIIAALERAVDVCLVHSGQHYDYELNQVFFDELG
IRKPDHFLDAVGASAAETIGRVIARSDAVFVDESPDALLLYGDTNTTLAVIAARRRHIPVFHLEAGNRCFDDRVPEEINR
RLVDHLSDINLPLTEHARRHLLAEGLPAQRIFVTGSPMKEVLDHYAPLVDASPVLTNLGVTAGHFLVVSAHREENVDAPE
LLIGLLETLNALAARYRVPIIVSTHPRTRDRLDALEASGRAPATDGLVRFCRPFGFADYIALQRAAQCVISDSGSLTEEA
SLLGFPAVMIREAHERPEGVDHGVAVSCLPRPDRVLAAVDLVVDAAQGDRAPRIVPDYDVDDVSRRVVRIIVSHIDYVRR
TVWFERPPVGTSEPTPGGTSLTLP
>Mature_583_residues
GVSHRIPAARPRPQTGHTATSPNTTGLDDGGAGGQTVPGQGARGQSIPGQGAGGPGVPGQGAGGPGVGAQGVGGQNVGGQ
GAEEQNVADQGAAGESTAGWGPAERGGMTAMTGTAGTTARTGPSVPTAPSTPIAPTGPTVPTVPNRRLPPDRQGAAGRMT
MPDRVPRTEIMGVPAPVPRGRPGPAEHRARVMILVGTRPEIVKLSRIIAALERAVDVCLVHSGQHYDYELNQVFFDELGI
RKPDHFLDAVGASAAETIGRVIARSDAVFVDESPDALLLYGDTNTTLAVIAARRRHIPVFHLEAGNRCFDDRVPEEINRR
LVDHLSDINLPLTEHARRHLLAEGLPAQRIFVTGSPMKEVLDHYAPLVDASPVLTNLGVTAGHFLVVSAHREENVDAPEL
LIGLLETLNALAARYRVPIIVSTHPRTRDRLDALEASGRAPATDGLVRFCRPFGFADYIALQRAAQCVISDSGSLTEEAS
LLGFPAVMIREAHERPEGVDHGVAVSCLPRPDRVLAAVDLVVDAAQGDRAPRIVPDYDVDDVSRRVVRIIVSHIDYVRRT
VWFERPPVGTSEPTPGGTSLTLP

Specific function: Catalyzes the reversible epimerization at C-2 of UDP-N- acetylglucosamine (UDP-GlcNAc) to produce UDP-N-acetylmannosamine (UDP-ManNAc), the activated donor of ManNAc residues [H]

COG id: COG0381

COG function: function code M; UDP-N-acetylglucosamine 2-epimerase

Gene ontology:

Cell location: Cytoplasm [H]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the UDP-N-acetylglucosamine 2-epimerase family [H]

Homologues:

Organism=Escherichia coli, GI48994967, Length=335, Percent_Identity=29.8507462686567, Blast_Score=93, Evalue=5e-20,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR003331 [H]

Pfam domain/function: PF02350 Epimerase_2 [H]

EC number: =5.1.3.14 [H]

Molecular weight: Translated: 61611; Mature: 61480

Theoretical pI: Translated: 6.51; Mature: 6.51

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.9 %Cys     (Translated Protein)
1.5 %Met     (Translated Protein)
2.4 %Cys+Met (Translated Protein)
0.9 %Cys     (Mature Protein)
1.4 %Met     (Mature Protein)
2.2 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MGVSHRIPAARPRPQTGHTATSPNTTGLDDGGAGGQTVPGQGARGQSIPGQGAGGPGVPG
CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC
QGAGGPGVGAQGVGGQNVGGQGAEEQNVADQGAAGESTAGWGPAERGGMTAMTGTAGTTA
CCCCCCCCCCCCCCCCCCCCCCCCHHCCCCCCCCCCCCCCCCCCCCCCCEEEECCCCCCC
RTGPSVPTAPSTPIAPTGPTVPTVPNRRLPPDRQGAAGRMTMPDRVPRTEIMGVPAPVPR
CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHCCCCCCCCCC
GRPGPAEHRARVMILVGTRPEIVKLSRIIAALERAVDVCLVHSGQHYDYELNQVFFDELG
CCCCCCCCCEEEEEEECCCCHHHHHHHHHHHHHHHHHEEEEECCCCCCCHHHHHHHHHHC
IRKPDHFLDAVGASAAETIGRVIARSDAVFVDESPDALLLYGDTNTTLAVIAARRRHIPV
CCCCHHHHHHHCCHHHHHHHHHHHCCCEEEEECCCCEEEEECCCCCEEEEEEHHHHCCCE
FHLEAGNRCFDDRVPEEINRRLVDHLSDINLPLTEHARRHLLAEGLPAQRIFVTGSPMKE
EEECCCCCCHHHCCCHHHHHHHHHHHHHCCCCHHHHHHHHHHHCCCCCCEEEEECCCHHH
VLDHYAPLVDASPVLTNLGVTAGHFLVVSAHREENVDAPELLIGLLETLNALAARYRVPI
HHHHHHCCCCCCHHHHHCCCCCCEEEEEEECCCCCCCHHHHHHHHHHHHHHHHHHHCCCE
IVSTHPRTRDRLDALEASGRAPATDGLVRFCRPFGFADYIALQRAAQCVISDSGSLTEEA
EEECCCCCHHHHHHHHHCCCCCCHHHHHHHHHHCCHHHHHHHHHHHHHEECCCCCCCHHH
SLLGFPAVMIREAHERPEGVDHGVAVSCLPRPDRVLAAVDLVVDAAQGDRAPRIVPDYDV
HHHCCHHHHHHHHHCCCCCCCCCCEEEECCCCHHHHHHHHHHHHHCCCCCCCCCCCCCCH
DDVSRRVVRIIVSHIDYVRRTVWFERPPVGTSEPTPGGTSLTLP
HHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCEECCC
>Mature Secondary Structure 
GVSHRIPAARPRPQTGHTATSPNTTGLDDGGAGGQTVPGQGARGQSIPGQGAGGPGVPG
CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC
QGAGGPGVGAQGVGGQNVGGQGAEEQNVADQGAAGESTAGWGPAERGGMTAMTGTAGTTA
CCCCCCCCCCCCCCCCCCCCCCCCHHCCCCCCCCCCCCCCCCCCCCCCCEEEECCCCCCC
RTGPSVPTAPSTPIAPTGPTVPTVPNRRLPPDRQGAAGRMTMPDRVPRTEIMGVPAPVPR
CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHCCCCCCCCCC
GRPGPAEHRARVMILVGTRPEIVKLSRIIAALERAVDVCLVHSGQHYDYELNQVFFDELG
CCCCCCCCCEEEEEEECCCCHHHHHHHHHHHHHHHHHEEEEECCCCCCCHHHHHHHHHHC
IRKPDHFLDAVGASAAETIGRVIARSDAVFVDESPDALLLYGDTNTTLAVIAARRRHIPV
CCCCHHHHHHHCCHHHHHHHHHHHCCCEEEEECCCCEEEEECCCCCEEEEEEHHHHCCCE
FHLEAGNRCFDDRVPEEINRRLVDHLSDINLPLTEHARRHLLAEGLPAQRIFVTGSPMKE
EEECCCCCCHHHCCCHHHHHHHHHHHHHCCCCHHHHHHHHHHHCCCCCCEEEEECCCHHH
VLDHYAPLVDASPVLTNLGVTAGHFLVVSAHREENVDAPELLIGLLETLNALAARYRVPI
HHHHHHCCCCCCHHHHHCCCCCCEEEEEEECCCCCCCHHHHHHHHHHHHHHHHHHHCCCE
IVSTHPRTRDRLDALEASGRAPATDGLVRFCRPFGFADYIALQRAAQCVISDSGSLTEEA
EEECCCCCHHHHHHHHHCCCCCCHHHHHHHHHHCCHHHHHHHHHHHHHEECCCCCCCHHH
SLLGFPAVMIREAHERPEGVDHGVAVSCLPRPDRVLAAVDLVVDAAQGDRAPRIVPDYDV
HHHCCHHHHHHHHHCCCCCCCCCCEEEECCCCHHHHHHHHHHHHHCCCCCCCCCCCCCCH
DDVSRRVVRIIVSHIDYVRRTVWFERPPVGTSEPTPGGTSLTLP
HHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCEECCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 8688087 [H]