Definition Shigella boydii Sb227, complete genome.
Accession NC_007613
Length 4,519,823

Click here to switch to the map view.

The map label for this gene is hycE [H]

Identifier: 82545204

GI number: 82545204

Start: 2805375

End: 2807084

Strand: Direct

Name: hycE [H]

Synonym: SBO_2797

Alternate gene names: 82545204

Gene position: 2805375-2807084 (Clockwise)

Preceding gene: 82545203

Following gene: 82545205

Centisome position: 62.07

GC content: 57.02

Gene sequence:

>1710_bases
ATGTCTGAAGAAAAATTAGGTCAACATTATCTCGCCGCGCTGAATGAGGCATTTCCGGGCGTCGTGCTGGACCACGCCTG
GCAGACCAAAGATCAGCTGACTGTCACCGTAAAGGTGAACTATCTGCCGGAAGTGGTGGAGTTTCTCTACTACAAGCAGG
GGGGCTGGCTGTCGGTGCTTTTTGGTAACGACGAACGCAAACTGAATGGTCATTACGCCGTTTATTACGTGCTGTCGATG
GAGAAGGGGACTAAGTGCTGGGTAACGGTTCGCGTCGAAGTTGATGCCAACAAACCGGAGTATCCGTCCGTGACGCCGCG
CGTTCCGGCGGCGGTGTGGGGCGAGCGCGAAGTGCGCGATATGTACGGTTTGATTCCGGTTGGTCTGCCGGATGAACGCC
GTCTGGTGCTGCCGGATGACTGGCCGGATGAACTTTATCCGCTGCGTAAAGACAGCATGGATTATCGTCAGCGTCCGGCA
CCGACCACCGATGCTGAAACCTACGAGTTCATCAACGAACTGGGCGACAAGAAAAACAACGTCGTGCCGATTGGTCCGCT
GCACGTCACTTCTGACGAACCGGGCCACTTCCGTCTGTTCGTCGATGGCGAAAACATTATCGACGCAGACTACCGCTTGT
TCTATGTCCATCGCGGTATGGAAAAACTGGCGGAAACCCGCATGGGTTATAACGAAGTGACCTTCCTCTCTGACCGTGTG
TGCGGGATCTGCGGCTTCGCCCACAGCACCGCCTACACCACGTCGGTGGAAAACGCGATGGGTATTCAGGTGCCAGAACG
TGCGCAGATGATCCGCGCCATTCTGCTGGAGGTGGAACGCCTGCACTCGCATCTGCTCAACCTCGGCCTCGCCTGCCACT
TTACCGGCTTCGACTCCGGCTTTATGCAATTCTTCCGCGTGCGTGAAACCTCCATGAAAATGGCCGAGATCCTCACCGGT
GCGCGTAAAACCTACGGCCTGAACCTGATCGGCGGGATTCGTCGCGATCTGTTGAAAGATGACATGATCCAGACCCGCCA
GCTGGCGCAACAGATGCGTCGTGAAGTGCAGGAGCTGGTGGATGTGCTGCTGAGCACACCGAACATGGAACAGCGCACCG
TCGGCATTGGTCGTCTGGACCCGGAAATTGCCCGCGATTTCAGTAACGTTGGCCCGATGGTCCGCGCCAGCGGACACGCT
CGCGATACCCGCGCTGATCACCCGTTTGTTGGTTATGGCCTGCTGCCAATGGAAGTCCACAGCGAGCAGGGCTGCGACGT
TATTTCGCGTCTGAAAGTGCGTATCAACGAAGTCTATACCGCGCTGAACATGATCGACTACGGTCTGGATAACCTGCCGG
GTGGCCCGCTGATGGTGGAAGGCTTTACCTACATTCCGCACCGTTTCGCGCTGGGCTTTGCCGAAGCGCCGCGCGGTGAT
GATATCCACTGGAGCATGACTGGCGACAACCAGAAGCTGTACCGCTGGCGCTGCCGTGCCGCGACCTACGCGAACTGGCC
GACCCTGCGCTACATGCTGCGTGGCAACACTGTTTCCGATGCGCCGCTGATTATCGGTAGCCTGGACCCTTGCTACTCCT
GTACCGACCGCATGACTGTGGTCGATGTACGTAAGAAGAAGAGCAAAGTGGTGCCGTACAAAGAACTCGAGCGCTACAGC
ATTGAGCGTAAAAACTCGCCGCTGAAATAA

Upstream 100 bases:

>100_bases
TGCGTCTTGATATTACTCCGCGCATTACCTGGGCTGGGTTTGGCTTTGCATTTTTAGCGTTCGTCTCCTTGCTGGCGGCG
TGATTAAAGAGAGTTTGAGC

Downstream 100 bases:

>100_bases
GGAATCGCCATGTTTACCTTTATCAAAAAAGTTATCAAAACCGGTACGGCGACCTCGTCTTATCCGCTGGAGCCGATTGC
GGTTGATAAAAACTTCCGTG

Product: large subunit of hydrogenase 3

Products: CO2; H2; oxidized ferredoxin + [C]

Alternate protein names: FHL subunit 5; Hydrogenase-3 component E [H]

Number of amino acids: Translated: 569; Mature: 568

Protein sequence:

>569_residues
MSEEKLGQHYLAALNEAFPGVVLDHAWQTKDQLTVTVKVNYLPEVVEFLYYKQGGWLSVLFGNDERKLNGHYAVYYVLSM
EKGTKCWVTVRVEVDANKPEYPSVTPRVPAAVWGEREVRDMYGLIPVGLPDERRLVLPDDWPDELYPLRKDSMDYRQRPA
PTTDAETYEFINELGDKKNNVVPIGPLHVTSDEPGHFRLFVDGENIIDADYRLFYVHRGMEKLAETRMGYNEVTFLSDRV
CGICGFAHSTAYTTSVENAMGIQVPERAQMIRAILLEVERLHSHLLNLGLACHFTGFDSGFMQFFRVRETSMKMAEILTG
ARKTYGLNLIGGIRRDLLKDDMIQTRQLAQQMRREVQELVDVLLSTPNMEQRTVGIGRLDPEIARDFSNVGPMVRASGHA
RDTRADHPFVGYGLLPMEVHSEQGCDVISRLKVRINEVYTALNMIDYGLDNLPGGPLMVEGFTYIPHRFALGFAEAPRGD
DIHWSMTGDNQKLYRWRCRAATYANWPTLRYMLRGNTVSDAPLIIGSLDPCYSCTDRMTVVDVRKKKSKVVPYKELERYS
IERKNSPLK

Sequences:

>Translated_569_residues
MSEEKLGQHYLAALNEAFPGVVLDHAWQTKDQLTVTVKVNYLPEVVEFLYYKQGGWLSVLFGNDERKLNGHYAVYYVLSM
EKGTKCWVTVRVEVDANKPEYPSVTPRVPAAVWGEREVRDMYGLIPVGLPDERRLVLPDDWPDELYPLRKDSMDYRQRPA
PTTDAETYEFINELGDKKNNVVPIGPLHVTSDEPGHFRLFVDGENIIDADYRLFYVHRGMEKLAETRMGYNEVTFLSDRV
CGICGFAHSTAYTTSVENAMGIQVPERAQMIRAILLEVERLHSHLLNLGLACHFTGFDSGFMQFFRVRETSMKMAEILTG
ARKTYGLNLIGGIRRDLLKDDMIQTRQLAQQMRREVQELVDVLLSTPNMEQRTVGIGRLDPEIARDFSNVGPMVRASGHA
RDTRADHPFVGYGLLPMEVHSEQGCDVISRLKVRINEVYTALNMIDYGLDNLPGGPLMVEGFTYIPHRFALGFAEAPRGD
DIHWSMTGDNQKLYRWRCRAATYANWPTLRYMLRGNTVSDAPLIIGSLDPCYSCTDRMTVVDVRKKKSKVVPYKELERYS
IERKNSPLK
>Mature_568_residues
SEEKLGQHYLAALNEAFPGVVLDHAWQTKDQLTVTVKVNYLPEVVEFLYYKQGGWLSVLFGNDERKLNGHYAVYYVLSME
KGTKCWVTVRVEVDANKPEYPSVTPRVPAAVWGEREVRDMYGLIPVGLPDERRLVLPDDWPDELYPLRKDSMDYRQRPAP
TTDAETYEFINELGDKKNNVVPIGPLHVTSDEPGHFRLFVDGENIIDADYRLFYVHRGMEKLAETRMGYNEVTFLSDRVC
GICGFAHSTAYTTSVENAMGIQVPERAQMIRAILLEVERLHSHLLNLGLACHFTGFDSGFMQFFRVRETSMKMAEILTGA
RKTYGLNLIGGIRRDLLKDDMIQTRQLAQQMRREVQELVDVLLSTPNMEQRTVGIGRLDPEIARDFSNVGPMVRASGHAR
DTRADHPFVGYGLLPMEVHSEQGCDVISRLKVRINEVYTALNMIDYGLDNLPGGPLMVEGFTYIPHRFALGFAEAPRGDD
IHWSMTGDNQKLYRWRCRAATYANWPTLRYMLRGNTVSDAPLIIGSLDPCYSCTDRMTVVDVRKKKSKVVPYKELERYSI
ERKNSPLK

Specific function: Hydrogen metabolism; FHL pathway. [C]

COG id: COG3261

COG function: function code C; Ni,Fe-hydrogenase III large subunit

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the complex I 49 kDa subunit family [H]

Homologues:

Organism=Homo sapiens, GI4758786, Length=387, Percent_Identity=25.5813953488372, Blast_Score=114, Evalue=2e-25,
Organism=Homo sapiens, GI260898743, Length=377, Percent_Identity=25.4641909814324, Blast_Score=110, Evalue=4e-24,
Organism=Escherichia coli, GI1789076, Length=569, Percent_Identity=99.8242530755712, Blast_Score=1184, Evalue=0.0,
Organism=Escherichia coli, GI1788832, Length=568, Percent_Identity=70.2464788732394, Blast_Score=857, Evalue=0.0,
Organism=Escherichia coli, GI145693162, Length=563, Percent_Identity=25.5772646536412, Blast_Score=158, Evalue=7e-40,
Organism=Caenorhabditis elegans, GI17568379, Length=387, Percent_Identity=25.5813953488372, Blast_Score=126, Evalue=4e-29,
Organism=Caenorhabditis elegans, GI17555284, Length=400, Percent_Identity=25.25, Blast_Score=123, Evalue=2e-28,
Organism=Drosophila melanogaster, GI221459469, Length=387, Percent_Identity=25.5813953488372, Blast_Score=141, Evalue=1e-33,
Organism=Drosophila melanogaster, GI24638644, Length=387, Percent_Identity=26.6149870801034, Blast_Score=136, Evalue=4e-32,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR001135
- InterPro:   IPR001268
- InterPro:   IPR014029
- InterPro:   IPR001501
- ProDom:   PD001581 [H]

Pfam domain/function: PF00329 Complex1_30kDa; PF00346 Complex1_49kDa; PF00374 NiFeSe_Hases [H]

EC number: NA

Molecular weight: Translated: 64967; Mature: 64836

Theoretical pI: Translated: 6.57; Mature: 6.57

Prosite motif: PS00535 COMPLEX1_49K

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.4 %Cys     (Translated Protein)
3.7 %Met     (Translated Protein)
5.1 %Cys+Met (Translated Protein)
1.4 %Cys     (Mature Protein)
3.5 %Met     (Mature Protein)
4.9 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSEEKLGQHYLAALNEAFPGVVLDHAWQTKDQLTVTVKVNYLPEVVEFLYYKQGGWLSVL
CCHHHHHHHHHHHHHHCCCCEEECCCCCCCCEEEEEEEECCHHHHHHHHHCCCCCEEEEE
FGNDERKLNGHYAVYYVLSMEKGTKCWVTVRVEVDANKPEYPSVTPRVPAAVWGEREVRD
ECCCCCEECCCEEEEEEEEECCCCEEEEEEEEEECCCCCCCCCCCCCCCHHHCCCHHHHH
MYGLIPVGLPDERRLVLPDDWPDELYPLRKDSMDYRQRPAPTTDAETYEFINELGDKKNN
HHCCCCCCCCCCCEEECCCCCCHHCCCCCCCCCHHHHCCCCCCCHHHHHHHHHHCCCCCC
VVPIGPLHVTSDEPGHFRLFVDGENIIDADYRLFYVHRGMEKLAETRMGYNEVTFLSDRV
EEECCCEEECCCCCCEEEEEECCCCEECCCEEEEEEHHHHHHHHHHHCCCCCEEEHHHHH
CGICGFAHSTAYTTSVENAMGIQVPERAQMIRAILLEVERLHSHLLNLGLACHFTGFDSG
HHHHCCCCCCCEEECCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHCCEEEEECCCCHH
FMQFFRVRETSMKMAEILTGARKTYGLNLIGGIRRDLLKDDMIQTRQLAQQMRREVQELV
HHHHHHHHHHHHHHHHHHHCCHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
DVLLSTPNMEQRTVGIGRLDPEIARDFSNVGPMVRASGHARDTRADHPFVGYGLLPMEVH
HHHHCCCCCHHHCCCCCCCCHHHHHHHHHCCCCEECCCCCCCCCCCCCEEEECEEEEEEC
SEQGCDVISRLKVRINEVYTALNMIDYGLDNLPGGPLMVEGFTYIPHRFALGFAEAPRGD
CCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCEEECCEEECCHHHHCCCCCCCCCC
DIHWSMTGDNQKLYRWRCRAATYANWPTLRYMLRGNTVSDAPLIIGSLDPCYSCTDRMTV
CEEEEEECCCCEEEEEEECCCCCCCCCEEEEEEECCCCCCCCEEEECCCCHHCCCCCEEE
VDVRKKKSKVVPYKELERYSIERKNSPLK
EEEHHHHCCCCCHHHHHHHHHHCCCCCCC
>Mature Secondary Structure 
SEEKLGQHYLAALNEAFPGVVLDHAWQTKDQLTVTVKVNYLPEVVEFLYYKQGGWLSVL
CHHHHHHHHHHHHHHCCCCEEECCCCCCCCEEEEEEEECCHHHHHHHHHCCCCCEEEEE
FGNDERKLNGHYAVYYVLSMEKGTKCWVTVRVEVDANKPEYPSVTPRVPAAVWGEREVRD
ECCCCCEECCCEEEEEEEEECCCCEEEEEEEEEECCCCCCCCCCCCCCCHHHCCCHHHHH
MYGLIPVGLPDERRLVLPDDWPDELYPLRKDSMDYRQRPAPTTDAETYEFINELGDKKNN
HHCCCCCCCCCCCEEECCCCCCHHCCCCCCCCCHHHHCCCCCCCHHHHHHHHHHCCCCCC
VVPIGPLHVTSDEPGHFRLFVDGENIIDADYRLFYVHRGMEKLAETRMGYNEVTFLSDRV
EEECCCEEECCCCCCEEEEEECCCCEECCCEEEEEEHHHHHHHHHHHCCCCCEEEHHHHH
CGICGFAHSTAYTTSVENAMGIQVPERAQMIRAILLEVERLHSHLLNLGLACHFTGFDSG
HHHHCCCCCCCEEECCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHCCEEEEECCCCHH
FMQFFRVRETSMKMAEILTGARKTYGLNLIGGIRRDLLKDDMIQTRQLAQQMRREVQELV
HHHHHHHHHHHHHHHHHHHCCHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
DVLLSTPNMEQRTVGIGRLDPEIARDFSNVGPMVRASGHARDTRADHPFVGYGLLPMEVH
HHHHCCCCCHHHCCCCCCCCHHHHHHHHHCCCCEECCCCCCCCCCCCCEEEECEEEEEEC
SEQGCDVISRLKVRINEVYTALNMIDYGLDNLPGGPLMVEGFTYIPHRFALGFAEAPRGD
CCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCEEECCEEECCHHHHCCCCCCCCCC
DIHWSMTGDNQKLYRWRCRAATYANWPTLRYMLRGNTVSDAPLIIGSLDPCYSCTDRMTV
CEEEEEECCCCEEEEEEECCCCCCCCCEEEEEEECCCCCCCCEEEECCCCHHCCCCCEEE
VDVRKKKSKVVPYKELERYSIERKNSPLK
EEEHHHHCCCCCHHHHHHHHHHCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: formate; Proton; reduced ferredoxin [C]

Specific reaction: formate = CO2 + H2 Proton + reduced ferredoxin = H2 + oxidized ferredoxin [C]

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 2187144; 9278503; 8125094 [H]