Definition Mycobacterium avium subsp. paratuberculosis K-10, complete genome.
Accession NC_002944
Length 4,829,781

Click here to switch to the map view.

The map label for this gene is fucA [H]

Identifier: 41407156

GI number: 41407156

Start: 1109428

End: 1110234

Strand: Direct

Name: fucA [H]

Synonym: MAP1058

Alternate gene names: 41407156

Gene position: 1109428-1110234 (Clockwise)

Preceding gene: 41407154

Following gene: 41407157

Centisome position: 22.97

GC content: 69.27

Gene sequence:

>807_bases
TTGTGTCACATGGCCAGCACGTTCACCGATTCGAAATCGGAATTGATGCGCCGGGCTGCCGAGCAGTTGACGGCGTTGCA
GGGCCGGGACGCCGCCGAACCGCCGTTGACCACCCGCCAGAAGCTGGCCCTGACCTGCCGGGCGCTGTTCGACGCCGGGC
ACGACTCGGGGCTGGCCGGGCAGATCACCGCCCGCGCCGAGGCCGACGGCACCTACTACACGCAGCGGCTCGGCCTGGGC
TTCGACGAGATCACCGACGGCAATCTGCTGCTGGTCGACGAGGACCTCAATGTCCTCGAGGGTGACGGAATGGCCAACCC
CGCCAACCGCTTTCACAGCTGGATCTATCGCGCCCGCCCCGACGTGCAGTGCATCGTGCACACCCACGCGTTCCACGTGG
CAGCCCTGTCCATGCTGGAGGTCCCGCTGGTGGTATCCCACATGGACACCACCCCGCTGTACGACGACTGCGCGTTTCTG
GCGGACTGGCCGGGCGTGCCCGTCGGCAACGAGGAGGGGGAGATCATCACCGCCGCGCTGGGCGACAAGAAGGCGGTGCT
GCTGGCCCACCACGGCCACGTCATCGCCGGCGCCAGCATCGAGGAGGCGTGCTCGTTGGGAATCCTCATCGAGCGCGCCG
CCAAGCTGCAGCTGGCCGCGATGGCTGCCGGCACCGTCAAGCAGCTGCCCGAGGAGCTGGCCCGCGAGGCCCACGACTGG
ACGCTGTCACCGCAGCGCAGCCGGGCCAACTTCGCCTACTACGCCCGCCGGGCCCTGGCCCGCCATCCCGACGCGCTGAC
CAGCTGA

Upstream 100 bases:

>100_bases
CGCAGCCAGCGCCTCCAGGGTGAGGCCGCGTTGCCTGCGGACGGGACGCAGCAGTGCTGTCACGAGGCTCCTATGACACA
AGGTTTCCTAACCTGCTACA

Downstream 100 bases:

>100_bases
GGAGCCAACCCTTGACCGAACCCAAGATCCACGGCATCATCGCCTATCCGGTTACGCCCTTCGCCGACAACGGGATTGAC
ACCGAGCGGCTGGCCGCGCT

Product: class II aldolase/adducin domain protein

Products: NA

Alternate protein names: L-fuculose-1-phosphate aldolase [H]

Number of amino acids: Translated: 268; Mature: 268

Protein sequence:

>268_residues
MCHMASTFTDSKSELMRRAAEQLTALQGRDAAEPPLTTRQKLALTCRALFDAGHDSGLAGQITARAEADGTYYTQRLGLG
FDEITDGNLLLVDEDLNVLEGDGMANPANRFHSWIYRARPDVQCIVHTHAFHVAALSMLEVPLVVSHMDTTPLYDDCAFL
ADWPGVPVGNEEGEIITAALGDKKAVLLAHHGHVIAGASIEEACSLGILIERAAKLQLAAMAAGTVKQLPEELAREAHDW
TLSPQRSRANFAYYARRALARHPDALTS

Sequences:

>Translated_268_residues
MCHMASTFTDSKSELMRRAAEQLTALQGRDAAEPPLTTRQKLALTCRALFDAGHDSGLAGQITARAEADGTYYTQRLGLG
FDEITDGNLLLVDEDLNVLEGDGMANPANRFHSWIYRARPDVQCIVHTHAFHVAALSMLEVPLVVSHMDTTPLYDDCAFL
ADWPGVPVGNEEGEIITAALGDKKAVLLAHHGHVIAGASIEEACSLGILIERAAKLQLAAMAAGTVKQLPEELAREAHDW
TLSPQRSRANFAYYARRALARHPDALTS
>Mature_268_residues
MCHMASTFTDSKSELMRRAAEQLTALQGRDAAEPPLTTRQKLALTCRALFDAGHDSGLAGQITARAEADGTYYTQRLGLG
FDEITDGNLLLVDEDLNVLEGDGMANPANRFHSWIYRARPDVQCIVHTHAFHVAALSMLEVPLVVSHMDTTPLYDDCAFL
ADWPGVPVGNEEGEIITAALGDKKAVLLAHHGHVIAGASIEEACSLGILIERAAKLQLAAMAAGTVKQLPEELAREAHDW
TLSPQRSRANFAYYARRALARHPDALTS

Specific function: Fucose metabolism; third step. [C]

COG id: COG0235

COG function: function code G; Ribulose-5-phosphate 4-epimerase and related epimerases and aldolases

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the aldolase class II family. AraD/FucA subfamily [H]

Homologues:

Organism=Escherichia coli, GI1789164, Length=196, Percent_Identity=30.1020408163265, Blast_Score=73, Evalue=2e-14,
Organism=Caenorhabditis elegans, GI115533216, Length=215, Percent_Identity=27.4418604651163, Blast_Score=75, Evalue=3e-14,
Organism=Caenorhabditis elegans, GI115533218, Length=215, Percent_Identity=27.4418604651163, Blast_Score=74, Evalue=7e-14,
Organism=Caenorhabditis elegans, GI71989560, Length=206, Percent_Identity=31.0679611650485, Blast_Score=74, Evalue=7e-14,
Organism=Caenorhabditis elegans, GI71989555, Length=206, Percent_Identity=31.0679611650485, Blast_Score=74, Evalue=9e-14,
Organism=Caenorhabditis elegans, GI71989544, Length=206, Percent_Identity=31.0679611650485, Blast_Score=74, Evalue=9e-14,
Organism=Caenorhabditis elegans, GI71989541, Length=206, Percent_Identity=31.0679611650485, Blast_Score=74, Evalue=9e-14,
Organism=Caenorhabditis elegans, GI71989550, Length=206, Percent_Identity=31.0679611650485, Blast_Score=74, Evalue=1e-13,
Organism=Drosophila melanogaster, GI281363763, Length=218, Percent_Identity=29.3577981651376, Blast_Score=75, Evalue=3e-14,
Organism=Drosophila melanogaster, GI281363757, Length=218, Percent_Identity=29.3577981651376, Blast_Score=75, Evalue=3e-14,
Organism=Drosophila melanogaster, GI17136738, Length=218, Percent_Identity=29.3577981651376, Blast_Score=75, Evalue=3e-14,
Organism=Drosophila melanogaster, GI281363755, Length=218, Percent_Identity=29.3577981651376, Blast_Score=75, Evalue=5e-14,
Organism=Drosophila melanogaster, GI281363751, Length=218, Percent_Identity=29.3577981651376, Blast_Score=75, Evalue=5e-14,
Organism=Drosophila melanogaster, GI24655690, Length=218, Percent_Identity=29.3577981651376, Blast_Score=75, Evalue=5e-14,
Organism=Drosophila melanogaster, GI24655685, Length=218, Percent_Identity=29.3577981651376, Blast_Score=75, Evalue=6e-14,
Organism=Drosophila melanogaster, GI281363761, Length=218, Percent_Identity=29.3577981651376, Blast_Score=74, Evalue=8e-14,
Organism=Drosophila melanogaster, GI281363759, Length=218, Percent_Identity=29.3577981651376, Blast_Score=74, Evalue=8e-14,
Organism=Drosophila melanogaster, GI281363753, Length=218, Percent_Identity=29.3577981651376, Blast_Score=74, Evalue=8e-14,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR001303
- InterPro:   IPR004782 [H]

Pfam domain/function: PF00596 Aldolase_II [H]

EC number: =4.1.2.17 [H]

Molecular weight: Translated: 29080; Mature: 29080

Theoretical pI: Translated: 5.50; Mature: 5.50

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.9 %Cys     (Translated Protein)
2.6 %Met     (Translated Protein)
4.5 %Cys+Met (Translated Protein)
1.9 %Cys     (Mature Protein)
2.6 %Met     (Mature Protein)
4.5 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MCHMASTFTDSKSELMRRAAEQLTALQGRDAAEPPLTTRQKLALTCRALFDAGHDSGLAG
CCCCCCCCCCCHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHCCCCCCCCE
QITARAEADGTYYTQRLGLGFDEITDGNLLLVDEDLNVLEGDGMANPANRFHSWIYRARP
EEEEEECCCCCEEHHHHCCCHHHCCCCCEEEEECCCCEECCCCCCCHHHHHHHHHHHCCC
DVQCIVHTHAFHVAALSMLEVPLVVSHMDTTPLYDDCAFLADWPGVPVGNEEGEIITAAL
CCEEEEEHHHHHHHHHHHHHHHHHEECCCCCCCHHHHHHHHCCCCCCCCCCCCCEEEEEC
GDKKAVLLAHHGHVIAGASIEEACSLGILIERAAKLQLAAMAAGTVKQLPEELAREAHDW
CCCEEEEEEECCCEEECCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCC
TLSPQRSRANFAYYARRALARHPDALTS
CCCCCCCCCHHHHHHHHHHHHCCHHCCC
>Mature Secondary Structure
MCHMASTFTDSKSELMRRAAEQLTALQGRDAAEPPLTTRQKLALTCRALFDAGHDSGLAG
CCCCCCCCCCCHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHCCCCCCCCE
QITARAEADGTYYTQRLGLGFDEITDGNLLLVDEDLNVLEGDGMANPANRFHSWIYRARP
EEEEEECCCCCEEHHHHCCCHHHCCCCCEEEEECCCCEECCCCCCCHHHHHHHHHHHCCC
DVQCIVHTHAFHVAALSMLEVPLVVSHMDTTPLYDDCAFLADWPGVPVGNEEGEIITAAL
CCEEEEEHHHHHHHHHHHHHHHHHEECCCCCCCHHHHHHHHCCCCCCCCCCCCCEEEEEC
GDKKAVLLAHHGHVIAGASIEEACSLGILIERAAKLQLAAMAAGTVKQLPEELAREAHDW
CCCEEEEEEECCCEEECCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCC
TLSPQRSRANFAYYARRALARHPDALTS
CCCCCCCCCHHHHHHHHHHHHCCHHCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: 11206551; 11258796 [H]