Definition Vibrio fischeri ES114 chromosome I, complete genome.
Accession NC_006840
Length 2,897,536

Click here to switch to the map view.

The map label for this gene is yggW [H]

Identifier: 59711031

GI number: 59711031

Start: 454132

End: 455292

Strand: Reverse

Name: yggW [H]

Synonym: VF_0424

Alternate gene names: 59711031

Gene position: 455292-454132 (Counterclockwise)

Preceding gene: 59711032

Following gene: 172087663

Centisome position: 15.71

GC content: 40.31

Gene sequence:

>1161_bases
ATGCTTATTCCACCACCTCTAAGCCTATATATTCATATTCCTTGGTGCATTCAGAAATGTCCATATTGTGACTTTAACTC
TCATGCTTTAAAAGCTGAGATCCCAGAAGCTCAATACATTTCAGCCTTGATTGATGATCTTGATACGGATCTTGCTCGTT
ATGATATGCAAAGTGAACCACGTAAGCTGCATTCTATTTTTATTGGTGGTGGTACACCAAGCCTAATCACAGCTCCTGAG
ATAAAACGACTACTAAGTGAAGTTGAAAAGCGCCTTCCCTTTGCTGGTGATATTGAGATCACAATGGAAGCCAATCCGGG
AACCGTTGAAGCAGGTCGCTTTGTTAAATATCGACAAGCGGGCGTTAACCGTATTTCTATTGGTGTACAAAGCTTTCAGC
AAGAAAAACTAGAAAAGCTTGGTCGAATTCACGGTAAAGATGAAGCGATTCGAGCTGCACATCTTGCTCATGAAGCACAA
TTAAACAGCTTCAACCTCGATCTTATGCATGGTTTACCAAACCAAAGCATTGAGGATGCACTGTCTGATTTACAACAAGC
TATTGATCTTAATCCTCCTCATTTATCTTGGTATCAATTAACCATTGAACCAAATACCGTGTTTTACTATAAGCCACCAA
CACTTCCTGACGACGACGACCTATGGGATATTTTCGAACAAGGTCATCAAATGCTTGCCAAAGCAGGTTATGTTCAGTAT
GAGATATCTGGCTACAGTAAAGTAGGTTATCAGTGTCGCCATAACTTAAATTATTGGCGCTTTGGGGATTATCTGGGTAT
TGGTTGTGGTGCTCATGGTAAATTGAGTTTCGCTGATGGCCGTATTGTTAGAACCACGAAAATTAAGCATCCTCGCGGAT
TTCTAGATCTAACAAAACCTTATTTAATCGATGAGCAAGAGGTAATGGATCACGATAGACCTTTCGAATTCTTTATGAAC
CGTTTTCGTCTATTAGAAGCATGTCCAAAGCAAGAGTTCTTAGATACAACAGGCTTAGGTTTTGACACCATTCAAGAAAC
CATCGATTGGGCGAAAGAGAAAAAGTATCTCGATGAAACCGAAACGCACTGGCAAATCACAGAGCATGGTAAGTTGTTTT
TGAATGATTTGTTGGAAGCCTTCATGGGGGATGAGGATTAA

Upstream 100 bases:

>100_bases
TTCATCTGCTGAACTTGAACCTGCACGTAAAAAACAACTATCTCACCGTGGCCAAGCTCTGAAAAAGCTCTTTGCAGCAT
TAAAAGAAGGTCAGTAAGTA

Downstream 100 bases:

>100_bases
GAGCCGGCTTCAGATCGCTTCGCTTAAAGGTTTCAGTAAGAGCAAAGAATCTTTTCCTGAAACCTTTAGGGAGCTTGCGA
CCGTCCTTAACCCTGCTCTT

Product: coproporphyrinogen III oxidase

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 386; Mature: 386

Protein sequence:

>386_residues
MLIPPPLSLYIHIPWCIQKCPYCDFNSHALKAEIPEAQYISALIDDLDTDLARYDMQSEPRKLHSIFIGGGTPSLITAPE
IKRLLSEVEKRLPFAGDIEITMEANPGTVEAGRFVKYRQAGVNRISIGVQSFQQEKLEKLGRIHGKDEAIRAAHLAHEAQ
LNSFNLDLMHGLPNQSIEDALSDLQQAIDLNPPHLSWYQLTIEPNTVFYYKPPTLPDDDDLWDIFEQGHQMLAKAGYVQY
EISGYSKVGYQCRHNLNYWRFGDYLGIGCGAHGKLSFADGRIVRTTKIKHPRGFLDLTKPYLIDEQEVMDHDRPFEFFMN
RFRLLEACPKQEFLDTTGLGFDTIQETIDWAKEKKYLDETETHWQITEHGKLFLNDLLEAFMGDED

Sequences:

>Translated_386_residues
MLIPPPLSLYIHIPWCIQKCPYCDFNSHALKAEIPEAQYISALIDDLDTDLARYDMQSEPRKLHSIFIGGGTPSLITAPE
IKRLLSEVEKRLPFAGDIEITMEANPGTVEAGRFVKYRQAGVNRISIGVQSFQQEKLEKLGRIHGKDEAIRAAHLAHEAQ
LNSFNLDLMHGLPNQSIEDALSDLQQAIDLNPPHLSWYQLTIEPNTVFYYKPPTLPDDDDLWDIFEQGHQMLAKAGYVQY
EISGYSKVGYQCRHNLNYWRFGDYLGIGCGAHGKLSFADGRIVRTTKIKHPRGFLDLTKPYLIDEQEVMDHDRPFEFFMN
RFRLLEACPKQEFLDTTGLGFDTIQETIDWAKEKKYLDETETHWQITEHGKLFLNDLLEAFMGDED
>Mature_386_residues
MLIPPPLSLYIHIPWCIQKCPYCDFNSHALKAEIPEAQYISALIDDLDTDLARYDMQSEPRKLHSIFIGGGTPSLITAPE
IKRLLSEVEKRLPFAGDIEITMEANPGTVEAGRFVKYRQAGVNRISIGVQSFQQEKLEKLGRIHGKDEAIRAAHLAHEAQ
LNSFNLDLMHGLPNQSIEDALSDLQQAIDLNPPHLSWYQLTIEPNTVFYYKPPTLPDDDDLWDIFEQGHQMLAKAGYVQY
EISGYSKVGYQCRHNLNYWRFGDYLGIGCGAHGKLSFADGRIVRTTKIKHPRGFLDLTKPYLIDEQEVMDHDRPFEFFMN
RFRLLEACPKQEFLDTTGLGFDTIQETIDWAKEKKYLDETETHWQITEHGKLFLNDLLEAFMGDED

Specific function: Unknown

COG id: COG0635

COG function: function code H; Coproporphyrinogen III oxidase and related Fe-S oxidoreductases

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the anaerobic coproporphyrinogen-III oxidase family [H]

Homologues:

Organism=Homo sapiens, GI8922911, Length=272, Percent_Identity=34.9264705882353, Blast_Score=179, Evalue=3e-45,
Organism=Escherichia coli, GI1789325, Length=384, Percent_Identity=66.1458333333333, Blast_Score=533, Evalue=1e-153,
Organism=Escherichia coli, GI87082341, Length=236, Percent_Identity=30.0847457627119, Blast_Score=113, Evalue=3e-26,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR006638
- InterPro:   IPR004559
- InterPro:   IPR010723
- InterPro:   IPR007197 [H]

Pfam domain/function: PF06969 HemN_C; PF04055 Radical_SAM [H]

EC number: NA

Molecular weight: Translated: 44309; Mature: 44309

Theoretical pI: Translated: 4.93; Mature: 4.93

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.6 %Cys     (Translated Protein)
2.1 %Met     (Translated Protein)
3.6 %Cys+Met (Translated Protein)
1.6 %Cys     (Mature Protein)
2.1 %Met     (Mature Protein)
3.6 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MLIPPPLSLYIHIPWCIQKCPYCDFNSHALKAEIPEAQYISALIDDLDTDLARYDMQSEP
CCCCCCCEEEEECCHHHHHCCCCCCCCCEEEECCCHHHHHHHHHHHHHHHHHHHCCCCCC
RKLHSIFIGGGTPSLITAPEIKRLLSEVEKRLPFAGDIEITMEANPGTVEAGRFVKYRQA
CEEEEEEECCCCCCCEECHHHHHHHHHHHHHCCCCCCEEEEEECCCCCCCCCHHHHHHHC
GVNRISIGVQSFQQEKLEKLGRIHGKDEAIRAAHLAHEAQLNSFNLDLMHGLPNQSIEDA
CCCEEEHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHCCCCCCHHHCCCCCCHHHHH
LSDLQQAIDLNPPHLSWYQLTIEPNTVFYYKPPTLPDDDDLWDIFEQGHQMLAKAGYVQY
HHHHHHHHCCCCCCCEEEEEEEECCEEEEECCCCCCCCCHHHHHHHHHHHHHHHCCCEEE
EISGYSKVGYQCRHNLNYWRFGDYLGIGCGAHGKLSFADGRIVRTTKIKHPRGFLDLTKP
EECCCHHHCHHHHCCCCEEEECCEEEECCCCCCEEEECCCEEEEEEECCCCCCCCCCCCC
YLIDEQEVMDHDRPFEFFMNRFRLLEACPKQEFLDTTGLGFDTIQETIDWAKEKKYLDET
CEECHHHHHCCCCCHHHHHHHHHHHHHCCCHHHHHHCCCCHHHHHHHHHHHHHHHHCCCC
ETHWQITEHGKLFLNDLLEAFMGDED
CCCEEECCCCHHHHHHHHHHHCCCCC
>Mature Secondary Structure
MLIPPPLSLYIHIPWCIQKCPYCDFNSHALKAEIPEAQYISALIDDLDTDLARYDMQSEP
CCCCCCCEEEEECCHHHHHCCCCCCCCCEEEECCCHHHHHHHHHHHHHHHHHHHCCCCCC
RKLHSIFIGGGTPSLITAPEIKRLLSEVEKRLPFAGDIEITMEANPGTVEAGRFVKYRQA
CEEEEEEECCCCCCCEECHHHHHHHHHHHHHCCCCCCEEEEEECCCCCCCCCHHHHHHHC
GVNRISIGVQSFQQEKLEKLGRIHGKDEAIRAAHLAHEAQLNSFNLDLMHGLPNQSIEDA
CCCEEEHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHCCCCCCHHHCCCCCCHHHHH
LSDLQQAIDLNPPHLSWYQLTIEPNTVFYYKPPTLPDDDDLWDIFEQGHQMLAKAGYVQY
HHHHHHHHCCCCCCCEEEEEEEECCEEEEECCCCCCCCCHHHHHHHHHHHHHHHCCCEEE
EISGYSKVGYQCRHNLNYWRFGDYLGIGCGAHGKLSFADGRIVRTTKIKHPRGFLDLTKP
EECCCHHHCHHHHCCCCEEEECCEEEECCCCCCEEEECCCEEEEEEECCCCCCCCCCCCC
YLIDEQEVMDHDRPFEFFMNRFRLLEACPKQEFLDTTGLGFDTIQETIDWAKEKKYLDET
CEECHHHHHCCCCCHHHHHHHHHHHHHCCCHHHHHHCCCCHHHHHHHHHHHHHHHHCCCC
ETHWQITEHGKLFLNDLLEAFMGDED
CCCEEECCCCHHHHHHHHHHHCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 9278503 [H]