Definition Prochlorococcus marinus str. MIT 9301, complete genome.
Accession NC_009091
Length 1,641,879

Click here to switch to the map view.

The map label for this gene is fcl [H]

Identifier: 126696783

GI number: 126696783

Start: 1215517

End: 1216530

Strand: Direct

Name: fcl [H]

Synonym: P9301_14451

Alternate gene names: 126696783

Gene position: 1215517-1216530 (Clockwise)

Preceding gene: 126696782

Following gene: 126696791

Centisome position: 74.03

GC content: 31.36

Gene sequence:

>1014_bases
ATGAATAAGAAGATGAAAAAGTTAATTTCTAAGGAAGATAGTTTTTTTGTCGCAGGACACAATGGAATGGTGGGAAGTGC
AGTAATACGCAGCTTAAAAAAAAAGGGCTATTGTTCAGAAAAATATAGTGGTAAACTTTTTACCGCAGATAAGAAAGACG
TTGATCTTCGAGATTTTAAAAATGTTTTAAAATGGTTTAAGAAAAATAAACCACGTATAGTTATCCTTGCTGCTGCAAAA
GTAGGAGGGATCTTAGCAAATCAAAATTATCCTTTTGATTTTATTTCAGATAACTTACGAATACAACAAAATGTTATTGA
GTCTGCCTGGGAAACAGGCTGTAAAAGATTCATGTTTCTTGGTAGTAGCTGCATTTATCCAAAGAATTCAAAAACACCTA
TTAAAGAAGAAGAACTACTAAAAAGTAAGTTAGAAAAGACAAATGAACCTTATGCCATAGCTAAGATAGCGGGAATCAAA
CTTTGCGAAGCACTAAGAAAACAACATGGTTTTGATGCTATTTCATTAATGCCAACAAATCTTTATGGCACAAATGATAA
TTATGATTTACAAAATAGTCATGTCCTGCCAGCTTTAGTCAGAAAGTTTTTTGAAGCTAAAATGAAAAGAAAAACATATA
TAACTTGTTGGGGAACTGGTAATCCCACTAGAGAGTTTCTTCATGTTGACGATTTAGCGGATGCAATAATTCATTGTTTG
GAGTTTTGGGACCCAAATCATTCAGATGCGCCCAAAAATTATGCAGGAGAAAAATTAAATTATTTAAATGTAGGTTCTGG
ATTCGAGATCTCAATAAAAGATCTTGCTCATGAAATTGCAAATTGTATTAACTACAAAGGAAAAATTATATGGGATTCAG
AAATGCCCGATGGAACATTTAGAAAAAATTTAGATTGTTCTAGGATTAAATCTTTAGGATGGGAATCAAAAATCTCATTA
AAAAATGGTTTGAGAATGACTATTGAAGAATTTAGAAGAAATTTTAAAAACTAA

Upstream 100 bases:

>100_bases
ACTCTAGAAAAGCTTATCAAAGAAATGATCCAAAATGATAAAGAATTAGCTGCTAAAGAATCATTATTAAAAAGGGAAGG
TTATAAGATAAATAGCTCAA

Downstream 100 bases:

>100_bases
ATGTTCACAAAAATTAAGGAGATATTTCTATTTTAAAAATAGTGAAATAAGTTGAATTAAAACTTTGAACTCAATCCCGA
GTAATCAAAGTTAAATATAT

Product: putative fucose synthetase

Products: NA

Alternate protein names: GDP-4-keto-6-deoxy-D-mannose-3,5-epimerase-4-reductase [H]

Number of amino acids: Translated: 337; Mature: 337

Protein sequence:

>337_residues
MNKKMKKLISKEDSFFVAGHNGMVGSAVIRSLKKKGYCSEKYSGKLFTADKKDVDLRDFKNVLKWFKKNKPRIVILAAAK
VGGILANQNYPFDFISDNLRIQQNVIESAWETGCKRFMFLGSSCIYPKNSKTPIKEEELLKSKLEKTNEPYAIAKIAGIK
LCEALRKQHGFDAISLMPTNLYGTNDNYDLQNSHVLPALVRKFFEAKMKRKTYITCWGTGNPTREFLHVDDLADAIIHCL
EFWDPNHSDAPKNYAGEKLNYLNVGSGFEISIKDLAHEIANCINYKGKIIWDSEMPDGTFRKNLDCSRIKSLGWESKISL
KNGLRMTIEEFRRNFKN

Sequences:

>Translated_337_residues
MNKKMKKLISKEDSFFVAGHNGMVGSAVIRSLKKKGYCSEKYSGKLFTADKKDVDLRDFKNVLKWFKKNKPRIVILAAAK
VGGILANQNYPFDFISDNLRIQQNVIESAWETGCKRFMFLGSSCIYPKNSKTPIKEEELLKSKLEKTNEPYAIAKIAGIK
LCEALRKQHGFDAISLMPTNLYGTNDNYDLQNSHVLPALVRKFFEAKMKRKTYITCWGTGNPTREFLHVDDLADAIIHCL
EFWDPNHSDAPKNYAGEKLNYLNVGSGFEISIKDLAHEIANCINYKGKIIWDSEMPDGTFRKNLDCSRIKSLGWESKISL
KNGLRMTIEEFRRNFKN
>Mature_337_residues
MNKKMKKLISKEDSFFVAGHNGMVGSAVIRSLKKKGYCSEKYSGKLFTADKKDVDLRDFKNVLKWFKKNKPRIVILAAAK
VGGILANQNYPFDFISDNLRIQQNVIESAWETGCKRFMFLGSSCIYPKNSKTPIKEEELLKSKLEKTNEPYAIAKIAGIK
LCEALRKQHGFDAISLMPTNLYGTNDNYDLQNSHVLPALVRKFFEAKMKRKTYITCWGTGNPTREFLHVDDLADAIIHCL
EFWDPNHSDAPKNYAGEKLNYLNVGSGFEISIKDLAHEIANCINYKGKIIWDSEMPDGTFRKNLDCSRIKSLGWESKISL
KNGLRMTIEEFRRNFKN

Specific function: Two step NADP-dependent conversion of GDP-4-dehydro-6- deoxy-D-mannose to GDP-fucose, involving an epimerase and a reductase reaction [H]

COG id: COG0451

COG function: function code MG; Nucleoside-diphosphate-sugar epimerases

Gene ontology:

Cell location: Cytoplasm [H]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the fucose synthase family [H]

Homologues:

Organism=Homo sapiens, GI4507709, Length=324, Percent_Identity=29.9382716049383, Blast_Score=154, Evalue=2e-37,
Organism=Homo sapiens, GI7657641, Length=355, Percent_Identity=24.2253521126761, Blast_Score=79, Evalue=5e-15,
Organism=Escherichia coli, GI1788365, Length=323, Percent_Identity=47.0588235294118, Blast_Score=306, Evalue=9e-85,
Organism=Caenorhabditis elegans, GI17554428, Length=326, Percent_Identity=27.9141104294479, Blast_Score=134, Evalue=6e-32,
Organism=Drosophila melanogaster, GI19922778, Length=303, Percent_Identity=28.3828382838284, Blast_Score=143, Evalue=1e-34,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR001509
- InterPro:   IPR016040 [H]

Pfam domain/function: PF01370 Epimerase [H]

EC number: =1.1.1.271 [H]

Molecular weight: Translated: 38548; Mature: 38548

Theoretical pI: Translated: 9.86; Mature: 9.86

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

2.4 %Cys     (Translated Protein)
2.4 %Met     (Translated Protein)
4.7 %Cys+Met (Translated Protein)
2.4 %Cys     (Mature Protein)
2.4 %Met     (Mature Protein)
4.7 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MNKKMKKLISKEDSFFVAGHNGMVGSAVIRSLKKKGYCSEKYSGKLFTADKKDVDLRDFK
CCHHHHHHHCCCCCEEEECCCCCHHHHHHHHHHHCCCCCCCCCCCEEECCCCCCCHHHHH
NVLKWFKKNKPRIVILAAAKVGGILANQNYPFDFISDNLRIQQNVIESAWETGCKRFMFL
HHHHHHHCCCCEEEEEECCCCCCEEECCCCCCHHHCCCHHHHHHHHHHHHHHHHHHHHHH
GSSCIYPKNSKTPIKEEELLKSKLEKTNEPYAIAKIAGIKLCEALRKQHGFDAISLMPTN
CCCCCCCCCCCCCCCHHHHHHHHHHHCCCCEEHHHHHHHHHHHHHHHHCCCCEEEEEECE
LYGTNDNYDLQNSHVLPALVRKFFEAKMKRKTYITCWGTGNPTREFLHVDDLADAIIHCL
EECCCCCCCCCCCCCHHHHHHHHHHHHHCCCEEEEEECCCCCHHHHEEHHHHHHHHHHHH
EFWDPNHSDAPKNYAGEKLNYLNVGSGFEISIKDLAHEIANCINYKGKIIWDSEMPDGTF
HHCCCCCCCCCCCCCCCCCCEEECCCCCEEEHHHHHHHHHHHHCCCCEEEECCCCCCCHH
RKNLDCSRIKSLGWESKISLKNGLRMTIEEFRRNFKN
HCCCCHHHHHHCCCCCEEHHHCCHHHHHHHHHHHHCC
>Mature Secondary Structure
MNKKMKKLISKEDSFFVAGHNGMVGSAVIRSLKKKGYCSEKYSGKLFTADKKDVDLRDFK
CCHHHHHHHCCCCCEEEECCCCCHHHHHHHHHHHCCCCCCCCCCCEEECCCCCCCHHHHH
NVLKWFKKNKPRIVILAAAKVGGILANQNYPFDFISDNLRIQQNVIESAWETGCKRFMFL
HHHHHHHCCCCEEEEEECCCCCCEEECCCCCCHHHCCCHHHHHHHHHHHHHHHHHHHHHH
GSSCIYPKNSKTPIKEEELLKSKLEKTNEPYAIAKIAGIKLCEALRKQHGFDAISLMPTN
CCCCCCCCCCCCCCCHHHHHHHHHHHCCCCEEHHHHHHHHHHHHHHHHCCCCEEEEEECE
LYGTNDNYDLQNSHVLPALVRKFFEAKMKRKTYITCWGTGNPTREFLHVDDLADAIIHCL
EECCCCCCCCCCCCCHHHHHHHHHHHHHCCCEEEEEECCCCCHHHHEEHHHHHHHHHHHH
EFWDPNHSDAPKNYAGEKLNYLNVGSGFEISIKDLAHEIANCINYKGKIIWDSEMPDGTF
HHCCCCCCCCCCCCCCCCCCEEECCCCCEEEHHHHHHHHHHHHCCCCEEEECCCCCCCHH
RKNLDCSRIKSLGWESKISLKNGLRMTIEEFRRNFKN
HCCCCHHHHHHCCCCCEEHHHCCHHHHHHHHHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: 7815923; 8759852; 9097040; 9278503; 9473059; 9862812 [H]