Definition Prochlorococcus marinus str. MIT 9313 chromosome, complete genome.
Accession NC_005071
Length 2,410,873

Click here to switch to the map view.

The map label for this gene is yggW [C]

Identifier: 33862590

GI number: 33862590

Start: 363233

End: 364543

Strand: Direct

Name: yggW [C]

Synonym: PMT0317

Alternate gene names: 33862590

Gene position: 363233-364543 (Clockwise)

Preceding gene: 33862584

Following gene: 33862598

Centisome position: 15.07

GC content: 55.99

Gene sequence:

>1311_bases
ATGAGAGAAGGTCTTGCTGTGTTGCCACCTCGCAGTGCCTATCTGCACATTCCTTTCTGCCATCGGCGTTGCTTTTATTG
CGATTTCGCTGTCGTGCCCCTTGGCGATCATGCCAATGGGGCTAAGGGCTCTGGCAGCGCCTCGATTCAGTCTTATCTGC
AGCTATTGCAACGGGAGATTGCGCTTGTCAAGCCTGGGCCAACGCTGGCCACGGTTTACATCGGCGGGGGAACACCATCT
CTGCTCAGCTCAGCTCAGATTGGTGCCCTGTTGGATCAGCTACGGCAACGGTTTGGCGTTCAGCTTGGTGCAGAAATCAC
ACTGGAAATGGATCCAGCTAGTTTCGATCAGGCTTATCTACAGGCCGTGTTAGCGGCTGGTGTCAACAGGGTGAGCTTGG
GTGGGCAGAGTTTCGATGATGCAGTGCTCGAGACGCTTGGGCGCCGTCATCGTCGCCACCATTTACTGGAGGCTTGCGGA
TGGTTGCATCAGGCTCATCAGTGCGGAGAGCTGAAAAGTTGGAGTTTGGATCTCATCCAGAACCTGCCAGGACAGGAGCT
GGTGGCTTGGAAGCAACAGCTTGTTGAGGCTATTGATACTGGTTCACCTCATCTTTCTATCTACGATTTATCTGTTGAAC
CAGGCACGGTATTTGCTTGGCGTCAGCGGCGGGGTGAGTTGGATTTGCCCGATAATGATTTAGCAGCTGAGCAGATGCAG
ACCACCAGTGTCTTGCTTCGTCAGGAAGGATTTGGCCGCTATGAAATCTCCAATTACGCCTTGCCAGGGCACGCCTCACG
GCACAACCGCGTGTATTGGAGTGGGGCAGGGTGGTGGGCGTTTGGTCAGGGTGCGACCAGTGCGCCCTGGGGCGAGAGGC
TGGCTCGTCCGCGCACAAGGGATGGTTACTGCAACTGGATTGAGGTTCAGGAGGCAGAAGGACTGGATTCCTCTCTAGTT
GCGGCTCAGGCAAGACCCTTACCTCTGGATGAACGGTTGTTGGTGGGTTTGCGTTGCCGTGAGGGAGTTGATCTTGAGGC
CCTCAGTAGGGCTTGGGGCTGGACTCATGAGCAGTGCAACGCTCTATTGCCGTCGTTGCAGGTGCGCTGGCAGGCGGCGT
TGGATCGGGGCTGGTTAGAGCTGCATGGACGACGTTGGCAGCTCAGTGACCCCGAGGGGATGGCCATCAGCAATCAGGTT
CTGGTGGAGATGTTGTTGTGGTGGCAGTCTTTGCCTGCTGATGCAGTTGCTTCACCCAACCTTGAAGGGCTTCTACGCAC
AGCTGGCGACCTTGGATCAATGGTTGACTGA

Upstream 100 bases:

>100_bases
CATGGGGTCAGATCGTGTCTGCTCGCTCCGGATGCAGGCAGCATGCACCATCCTCTGGAGCTTGGCCCGGGCAGATGTCC
GCACCTTTGCGGATTGATTG

Downstream 100 bases:

>100_bases
AGGGGGGTTGGCTGGGAGTCAGTCCCAACAGGTCAGCGGTGACCCTTACCTGTCCATCGCAATCTTCGCCAGCGCCGATA
CCGATCACGGGGATGGTGAG

Product: oxygen-independent coproporphyrinogen III oxidase

Products: Protoporphyrinogen IX; CO2; H2O

Alternate protein names: NA

Number of amino acids: Translated: 436; Mature: 436

Protein sequence:

>436_residues
MREGLAVLPPRSAYLHIPFCHRRCFYCDFAVVPLGDHANGAKGSGSASIQSYLQLLQREIALVKPGPTLATVYIGGGTPS
LLSSAQIGALLDQLRQRFGVQLGAEITLEMDPASFDQAYLQAVLAAGVNRVSLGGQSFDDAVLETLGRRHRRHHLLEACG
WLHQAHQCGELKSWSLDLIQNLPGQELVAWKQQLVEAIDTGSPHLSIYDLSVEPGTVFAWRQRRGELDLPDNDLAAEQMQ
TTSVLLRQEGFGRYEISNYALPGHASRHNRVYWSGAGWWAFGQGATSAPWGERLARPRTRDGYCNWIEVQEAEGLDSSLV
AAQARPLPLDERLLVGLRCREGVDLEALSRAWGWTHEQCNALLPSLQVRWQAALDRGWLELHGRRWQLSDPEGMAISNQV
LVEMLLWWQSLPADAVASPNLEGLLRTAGDLGSMVD

Sequences:

>Translated_436_residues
MREGLAVLPPRSAYLHIPFCHRRCFYCDFAVVPLGDHANGAKGSGSASIQSYLQLLQREIALVKPGPTLATVYIGGGTPS
LLSSAQIGALLDQLRQRFGVQLGAEITLEMDPASFDQAYLQAVLAAGVNRVSLGGQSFDDAVLETLGRRHRRHHLLEACG
WLHQAHQCGELKSWSLDLIQNLPGQELVAWKQQLVEAIDTGSPHLSIYDLSVEPGTVFAWRQRRGELDLPDNDLAAEQMQ
TTSVLLRQEGFGRYEISNYALPGHASRHNRVYWSGAGWWAFGQGATSAPWGERLARPRTRDGYCNWIEVQEAEGLDSSLV
AAQARPLPLDERLLVGLRCREGVDLEALSRAWGWTHEQCNALLPSLQVRWQAALDRGWLELHGRRWQLSDPEGMAISNQV
LVEMLLWWQSLPADAVASPNLEGLLRTAGDLGSMVD
>Mature_436_residues
MREGLAVLPPRSAYLHIPFCHRRCFYCDFAVVPLGDHANGAKGSGSASIQSYLQLLQREIALVKPGPTLATVYIGGGTPS
LLSSAQIGALLDQLRQRFGVQLGAEITLEMDPASFDQAYLQAVLAAGVNRVSLGGQSFDDAVLETLGRRHRRHHLLEACG
WLHQAHQCGELKSWSLDLIQNLPGQELVAWKQQLVEAIDTGSPHLSIYDLSVEPGTVFAWRQRRGELDLPDNDLAAEQMQ
TTSVLLRQEGFGRYEISNYALPGHASRHNRVYWSGAGWWAFGQGATSAPWGERLARPRTRDGYCNWIEVQEAEGLDSSLV
AAQARPLPLDERLLVGLRCREGVDLEALSRAWGWTHEQCNALLPSLQVRWQAALDRGWLELHGRRWQLSDPEGMAISNQV
LVEMLLWWQSLPADAVASPNLEGLLRTAGDLGSMVD

Specific function: Unknown

COG id: COG0635

COG function: function code H; Coproporphyrinogen III oxidase and related Fe-S oxidoreductases

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the anaerobic coproporphyrinogen-III oxidase family [H]

Homologues:

Organism=Homo sapiens, GI8922911, Length=277, Percent_Identity=36.8231046931408, Blast_Score=153, Evalue=3e-37,
Organism=Escherichia coli, GI1789325, Length=299, Percent_Identity=37.123745819398, Blast_Score=166, Evalue=2e-42,
Organism=Escherichia coli, GI87082341, Length=256, Percent_Identity=29.6875, Blast_Score=116, Evalue=2e-27,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR006638
- InterPro:   IPR004559
- InterPro:   IPR010723
- InterPro:   IPR007197 [H]

Pfam domain/function: PF06969 HemN_C; PF04055 Radical_SAM [H]

EC number: 1.3.3.3

Molecular weight: Translated: 48231; Mature: 48231

Theoretical pI: Translated: 5.90; Mature: 5.90

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.8 %Cys     (Translated Protein)
1.4 %Met     (Translated Protein)
3.2 %Cys+Met (Translated Protein)
1.8 %Cys     (Mature Protein)
1.4 %Met     (Mature Protein)
3.2 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MREGLAVLPPRSAYLHIPFCHRRCFYCDFAVVPLGDHANGAKGSGSASIQSYLQLLQREI
CCCCCEECCCCCCEEECCHHHCEEEEEEEEEEECCCCCCCCCCCCCHHHHHHHHHHHHHH
ALVKPGPTLATVYIGGGTPSLLSSAQIGALLDQLRQRFGVQLGAEITLEMDPASFDQAYL
EEECCCCCEEEEEECCCCHHHHHHHHHHHHHHHHHHHHCCEECCEEEEEECCCHHHHHHH
QAVLAAGVNRVSLGGQSFDDAVLETLGRRHRRHHLLEACGWLHQAHQCGELKSWSLDLIQ
HHHHHCCCCEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHH
NLPGQELVAWKQQLVEAIDTGSPHLSIYDLSVEPGTVFAWRQRRGELDLPDNDLAAEQMQ
CCCCHHHHHHHHHHHHHHHCCCCCEEEEEEECCCCCEEEEHHCCCCCCCCCCCHHHHHHH
TTSVLLRQEGFGRYEISNYALPGHASRHNRVYWSGAGWWAFGQGATSAPWGERLARPRTR
HHHHHHHHCCCCCEEECCCCCCCCCCCCCEEEECCCCEEEECCCCCCCCHHHHHCCCCCC
DGYCNWIEVQEAEGLDSSLVAAQARPLPLDERLLVGLRCREGVDLEALSRAWGWTHEQCN
CCCCCEEEEECCCCCCHHHHHHCCCCCCCCHHHHEEECCCCCCCHHHHHHHHCCCHHHHH
ALLPSLQVRWQAALDRGWLELHGRRWQLSDPEGMAISNQVLVEMLLWWQSLPADAVASPN
HHHHHHHHHHHHHHCCCHHHHCCCEEECCCCCCCEEHHHHHHHHHHHHHCCCCCHHCCCC
LEGLLRTAGDLGSMVD
HHHHHHHHHHHCCCCC
>Mature Secondary Structure
MREGLAVLPPRSAYLHIPFCHRRCFYCDFAVVPLGDHANGAKGSGSASIQSYLQLLQREI
CCCCCEECCCCCCEEECCHHHCEEEEEEEEEEECCCCCCCCCCCCCHHHHHHHHHHHHHH
ALVKPGPTLATVYIGGGTPSLLSSAQIGALLDQLRQRFGVQLGAEITLEMDPASFDQAYL
EEECCCCCEEEEEECCCCHHHHHHHHHHHHHHHHHHHHCCEECCEEEEEECCCHHHHHHH
QAVLAAGVNRVSLGGQSFDDAVLETLGRRHRRHHLLEACGWLHQAHQCGELKSWSLDLIQ
HHHHHCCCCEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHH
NLPGQELVAWKQQLVEAIDTGSPHLSIYDLSVEPGTVFAWRQRRGELDLPDNDLAAEQMQ
CCCCHHHHHHHHHHHHHHHCCCCCEEEEEEECCCCCEEEEHHCCCCCCCCCCCHHHHHHH
TTSVLLRQEGFGRYEISNYALPGHASRHNRVYWSGAGWWAFGQGATSAPWGERLARPRTR
HHHHHHHHCCCCCEEECCCCCCCCCCCCCEEEECCCCEEEECCCCCCCCHHHHHCCCCCC
DGYCNWIEVQEAEGLDSSLVAAQARPLPLDERLLVGLRCREGVDLEALSRAWGWTHEQCN
CCCCCEEEEECCCCCCHHHHHHCCCCCCCCHHHHEEECCCCCCCHHHHHHHHCCCHHHHH
ALLPSLQVRWQAALDRGWLELHGRRWQLSDPEGMAISNQVLVEMLLWWQSLPADAVASPN
HHHHHHHHHHHHHHCCCHHHHCCCEEECCCCCCCEEHHHHHHHHHHHHHCCCCCHHCCCC
LEGLLRTAGDLGSMVD
HHHHHHHHHHHCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: Coproporphyrinogen III; O2; H+

Specific reaction: coproporphyrinogen-III + O2 + 2 H+ = protoporphyrinogen-IX + 2 CO2 + 2 H2O

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 8905231 [H]