| Definition | Hyphomonas neptunium ATCC 15444 chromosome, complete genome. |
|---|---|
| Accession | NC_008358 |
| Length | 3,705,021 |
Click here to switch to the map view.
The map label for this gene is katE [H]
Identifier: 114800048
GI number: 114800048
Start: 2592883
End: 2594955
Strand: Direct
Name: katE [H]
Synonym: HNE_2467
Alternate gene names: 114800048
Gene position: 2592883-2594955 (Clockwise)
Preceding gene: 114798985
Following gene: 114798951
Centisome position: 69.98
GC content: 51.42
Gene sequence:
>2073_bases ATGTCACGACGTTCGATCCAATCGGGCAAAGGAAAAGCCGGAGAGCTGCATCAGACATCATCAGGTCCACGCGATGCTCT AACGACCAATCATGGAGTTCGGATATCCGATAATCAAAACAGCCTGCGCGCCGGATCGGTGGGGCCGACACTTCTGGAAG ACTTTGTTCTACGGGAAAAGATCTTCCACTTTGATCATGAGCGCATTCCTGAGCGCATCGTCCACGCACGAGGTAGCGCA GCACATGGTTATTTTGAATGTACCGATGCGATTCCCGGACTGTCGCGCGCAAGTCTATTTTCTGAAAAAGGAAAGAGGAC GCCTGTATTTACGCGGTTTTCGACCGTTGCTGGCGGAGCGGGTTCAGTGGACACACCGCGCGATGTGCGTGGATTTGCGG TGAAATTCTATACTGACGAAGGGAACTGGGATCTCGTTGGAAATAATATTCCGGTGTTTTTCATTCAGGATGCAATCAAA TTTCCAGACCTTATCCATTCGGTAAAAATGGAAGCTGACAGAGGCTTTCCACAAGCGGCGAGCGCGCACGATACGTTTTG GGACTTCATCTCGCTGATGCCTGAAACCATGCACACCATGATCTGGGCCATGTCTGATCGCGCGATCCCTCGTTCTTACA GGATGATGGAAGGATTTGGTGTTCACACTTTCCGGCTGGTGAATGCGAAGGGGAAATCGACTTTTGTGAAGTTCCACTGG AAGCCAAAGCTTGGCCTGCAATCACTGGTATGGGATGAATCTGCCAAGCTGCAGGGAGCCGACAACGACTTTCACCGCCG GGACCTTTGGGAGGCGATCGATTCAGGAAATTTTCCGGAATGGAATTTCGGGATTCAGGTAATCTCCGAAAAACTCGCTG AGGAGCTTCCCTATAATGTGCTCGACCCAACCAAGATCGTGCCCGAGGAAATAGCCCCAGTACGGATCATCGGGCGGATG GTTCTGGACCGAAACCCCGACAACCACTTTGCTGAAAATGAACAGGCTGCCTTCCTGCCCTCCAATGTCGTTCCTGGAAT AGATTTCACGAATGATCCCCTTCTTCAAGGCAGACTGTTTTCGTATCTAGACACACAAAAGTCTCGCCTAGGAACAACCA ATTTCCATCAGATACCCATCAACGCGCCGAAATGCCCATTTGCAAACATGCAGCGCGATGGGATGATGCAGACATTCGTG CCAAAGGGCCGCGCAAACTATGAGCCGAATACATTGGATGAAGCGGGTGAAGCTGCTGGTCCACGCGCCTCGAAAGAAGG CTTCCGAACATTCGAGAGCAATACCGAGTTAGGAAACAGCCCAACGGACAAATTAAGGGTGCGGGACGAAACTTTTGGCG ACCATTTCAGCCAACCCCGCATGTTCTGGCATTCTCAAACCGAAAATGAACAGGCCCATATTGCCTCGGCACTTGTCTTC GAATTGTCTAAAGTTGGAACTGAACACATCCGCAAGCGCACGCTATCCGTTATTCGGAACATTGATCACGACCTTGCAAA ACGTGTAGCCGATGGCTTGGGATTGAAAGTGCCAGCTGCGACGCCGCCGTTCAGAGAACCAGTAGACTTGGGATCATCCG ATTCCCTCTCTATACAGAAGAACTGGCAAACCACGATAAGGGGCCGAACAGTAGCTATCCTCTTTGCGGAAGGATCGGAC AAGGACGCAATCGATGAATTGACGTCGAGTATTGAAGGCAAGGGTGGCTCGGTATACTTGGTGGCGCCTAAAGTTGGCCC TCTGAAGGTCAAGGGTGGAATGCTCCAAGCAGATGGCCAGCTTGCAGGCTCACCATCGCCTCTGTTTGATGCTGTCGCAA TGGTGTTGATGCCGGATCAGGTTGAGAAACTGATGAAAGACTCTGCTGCACGCGGCTGGGTGAGTGACGCATATTCACAT TTGAAAGCCATTGGGTATTGCCCTGGCTCGAAGGCGCTTCTGGAAGATTGTGGAATTGTGTTTGACGACGGCATCGTGCC AAATGAAAAATGGGCGAAGGCTGCCGCGCGTCGGTATTGGGATCGTGAATCTAATCTGCGCGATCTGGCTTGA
Upstream 100 bases:
>100_bases ACGATGCGCCCGGAACCGATGACACTCTGCCGCGTTTATCTGTTCCTGGGGACATTCTTTGAATCCCCCAGGAACTCAAT CGCAACAAGAGGGTGCAGTT
Downstream 100 bases:
>100_bases GCCCAAGGGCGCCACTGTAAGGAGGTGCCCGCAATATGGCAAAGCAGAAAGATGATACCCGCAAAGATGATCTGCGAACC GGTCAACCCTTTTGGCTCAG
Product: catalase HPII
Products: NA
Alternate protein names: KAT2 [H]
Number of amino acids: Translated: 690; Mature: 689
Protein sequence:
>690_residues MSRRSIQSGKGKAGELHQTSSGPRDALTTNHGVRISDNQNSLRAGSVGPTLLEDFVLREKIFHFDHERIPERIVHARGSA AHGYFECTDAIPGLSRASLFSEKGKRTPVFTRFSTVAGGAGSVDTPRDVRGFAVKFYTDEGNWDLVGNNIPVFFIQDAIK FPDLIHSVKMEADRGFPQAASAHDTFWDFISLMPETMHTMIWAMSDRAIPRSYRMMEGFGVHTFRLVNAKGKSTFVKFHW KPKLGLQSLVWDESAKLQGADNDFHRRDLWEAIDSGNFPEWNFGIQVISEKLAEELPYNVLDPTKIVPEEIAPVRIIGRM VLDRNPDNHFAENEQAAFLPSNVVPGIDFTNDPLLQGRLFSYLDTQKSRLGTTNFHQIPINAPKCPFANMQRDGMMQTFV PKGRANYEPNTLDEAGEAAGPRASKEGFRTFESNTELGNSPTDKLRVRDETFGDHFSQPRMFWHSQTENEQAHIASALVF ELSKVGTEHIRKRTLSVIRNIDHDLAKRVADGLGLKVPAATPPFREPVDLGSSDSLSIQKNWQTTIRGRTVAILFAEGSD KDAIDELTSSIEGKGGSVYLVAPKVGPLKVKGGMLQADGQLAGSPSPLFDAVAMVLMPDQVEKLMKDSAARGWVSDAYSH LKAIGYCPGSKALLEDCGIVFDDGIVPNEKWAKAAARRYWDRESNLRDLA
Sequences:
>Translated_690_residues MSRRSIQSGKGKAGELHQTSSGPRDALTTNHGVRISDNQNSLRAGSVGPTLLEDFVLREKIFHFDHERIPERIVHARGSA AHGYFECTDAIPGLSRASLFSEKGKRTPVFTRFSTVAGGAGSVDTPRDVRGFAVKFYTDEGNWDLVGNNIPVFFIQDAIK FPDLIHSVKMEADRGFPQAASAHDTFWDFISLMPETMHTMIWAMSDRAIPRSYRMMEGFGVHTFRLVNAKGKSTFVKFHW KPKLGLQSLVWDESAKLQGADNDFHRRDLWEAIDSGNFPEWNFGIQVISEKLAEELPYNVLDPTKIVPEEIAPVRIIGRM VLDRNPDNHFAENEQAAFLPSNVVPGIDFTNDPLLQGRLFSYLDTQKSRLGTTNFHQIPINAPKCPFANMQRDGMMQTFV PKGRANYEPNTLDEAGEAAGPRASKEGFRTFESNTELGNSPTDKLRVRDETFGDHFSQPRMFWHSQTENEQAHIASALVF ELSKVGTEHIRKRTLSVIRNIDHDLAKRVADGLGLKVPAATPPFREPVDLGSSDSLSIQKNWQTTIRGRTVAILFAEGSD KDAIDELTSSIEGKGGSVYLVAPKVGPLKVKGGMLQADGQLAGSPSPLFDAVAMVLMPDQVEKLMKDSAARGWVSDAYSH LKAIGYCPGSKALLEDCGIVFDDGIVPNEKWAKAAARRYWDRESNLRDLA >Mature_689_residues SRRSIQSGKGKAGELHQTSSGPRDALTTNHGVRISDNQNSLRAGSVGPTLLEDFVLREKIFHFDHERIPERIVHARGSAA HGYFECTDAIPGLSRASLFSEKGKRTPVFTRFSTVAGGAGSVDTPRDVRGFAVKFYTDEGNWDLVGNNIPVFFIQDAIKF PDLIHSVKMEADRGFPQAASAHDTFWDFISLMPETMHTMIWAMSDRAIPRSYRMMEGFGVHTFRLVNAKGKSTFVKFHWK PKLGLQSLVWDESAKLQGADNDFHRRDLWEAIDSGNFPEWNFGIQVISEKLAEELPYNVLDPTKIVPEEIAPVRIIGRMV LDRNPDNHFAENEQAAFLPSNVVPGIDFTNDPLLQGRLFSYLDTQKSRLGTTNFHQIPINAPKCPFANMQRDGMMQTFVP KGRANYEPNTLDEAGEAAGPRASKEGFRTFESNTELGNSPTDKLRVRDETFGDHFSQPRMFWHSQTENEQAHIASALVFE LSKVGTEHIRKRTLSVIRNIDHDLAKRVADGLGLKVPAATPPFREPVDLGSSDSLSIQKNWQTTIRGRTVAILFAEGSDK DAIDELTSSIEGKGGSVYLVAPKVGPLKVKGGMLQADGQLAGSPSPLFDAVAMVLMPDQVEKLMKDSAARGWVSDAYSHL KAIGYCPGSKALLEDCGIVFDDGIVPNEKWAKAAARRYWDRESNLRDLA
Specific function: Decomposes hydrogen peroxide into water and oxygen; serves to protect cells from the toxic effects of hydrogen peroxide. Could protect cells in nodules which have a high potential to produce hydrogen peroxide because of the strong reducing conditions requ
COG id: COG0753
COG function: function code P; Catalase
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the catalase family. HPII subfamily [H]
Homologues:
Organism=Homo sapiens, GI4557014, Length=398, Percent_Identity=48.7437185929648, Blast_Score=375, Evalue=1e-104, Organism=Escherichia coli, GI48994891, Length=673, Percent_Identity=51.5601783060921, Blast_Score=665, Evalue=0.0, Organism=Caenorhabditis elegans, GI25151141, Length=448, Percent_Identity=45.0892857142857, Blast_Score=374, Evalue=1e-103, Organism=Caenorhabditis elegans, GI25147792, Length=449, Percent_Identity=44.7661469933185, Blast_Score=373, Evalue=1e-103, Organism=Caenorhabditis elegans, GI71998444, Length=443, Percent_Identity=43.3408577878104, Blast_Score=369, Evalue=1e-102, Organism=Saccharomyces cerevisiae, GI6320462, Length=395, Percent_Identity=44.3037974683544, Blast_Score=322, Evalue=2e-88, Organism=Saccharomyces cerevisiae, GI6321525, Length=532, Percent_Identity=36.0902255639098, Blast_Score=310, Evalue=5e-85, Organism=Drosophila melanogaster, GI17981717, Length=494, Percent_Identity=41.2955465587045, Blast_Score=358, Evalue=1e-98, Organism=Drosophila melanogaster, GI19920968, Length=491, Percent_Identity=39.1038696537678, Blast_Score=353, Evalue=3e-97,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR002226 - InterPro: IPR020835 - InterPro: IPR010582 - InterPro: IPR018028 - InterPro: IPR011614 [H]
Pfam domain/function: PF00199 Catalase; PF06628 Catalase-rel [H]
EC number: =1.11.1.6 [H]
Molecular weight: Translated: 76615; Mature: 76484
Theoretical pI: Translated: 6.77; Mature: 6.77
Prosite motif: PS00437 CATALASE_1 ; PS00438 CATALASE_2
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.6 %Cys (Translated Protein) 2.5 %Met (Translated Protein) 3.0 %Cys+Met (Translated Protein) 0.6 %Cys (Mature Protein) 2.3 %Met (Mature Protein) 2.9 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MSRRSIQSGKGKAGELHQTSSGPRDALTTNHGVRISDNQNSLRAGSVGPTLLEDFVLREK CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCEEEECCCCCCCCCCCCHHHHHHHHHHHH IFHFDHERIPERIVHARGSAAHGYFECTDAIPGLSRASLFSEKGKRTPVFTRFSTVAGGA HHHCCHHHHHHHHHHCCCCCCCCCEEEHHCCCCCHHHHHHHHCCCCCCEEEEHHHHCCCC GSVDTPRDVRGFAVKFYTDEGNWDLVGNNIPVFFIQDAIKFPDLIHSVKMEADRGFPQAA CCCCCCCCCCEEEEEEEECCCCEEEECCCCCEEEECCHHHHHHHHHHHHHHHCCCCCCCC SAHDTFWDFISLMPETMHTMIWAMSDRAIPRSYRMMEGFGVHTFRLVNAKGKSTFVKFHW CCHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHCCCCEEEEEEECCCCCEEEEEEE KPKLGLQSLVWDESAKLQGADNDFHRRDLWEAIDSGNFPEWNFGIQVISEKLAEELPYNV CCCCCHHHHHCCCCCCCCCCCCCHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHCCCCC LDPTKIVPEEIAPVRIIGRMVLDRNPDNHFAENEQAAFLPSNVVPGIDFTNDPLLQGRLF CCCCCCCHHHCCHHHHHHHHHHCCCCCCCCCCCCCCEECCCCCCCCCCCCCCCCHHHHHH SYLDTQKSRLGTTNFHQIPINAPKCPFANMQRDGMMQTFVPKGRANYEPNTLDEAGEAAG HHHHHHHHHCCCCCCEEECCCCCCCCCCCCCCCCCHHHHCCCCCCCCCCCCHHHHCCCCC PRASKEGFRTFESNTELGNSPTDKLRVRDETFGDHFSQPRMFWHSQTENEQAHIASALVF CCCCHHHHHHHCCCCCCCCCCCHHEEECCHHHHHCCCCCCEEECCCCCCCHHHHHHHHHH ELSKVGTEHIRKRTLSVIRNIDHDLAKRVADGLGLKVPAATPPFREPVDLGSSDSLSIQK HHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHCCCEECCCCCCCCCCCCCCCCCCCEEEEC NWQTTIRGRTVAILFAEGSDKDAIDELTSSIEGKGGSVYLVAPKVGPLKVKGGMLQADGQ CCHHEECCCEEEEEEECCCCHHHHHHHHHHHCCCCCEEEEEECCCCCEEECCCEEEECCC LAGSPSPLFDAVAMVLMPDQVEKLMKDSAARGWVSDAYSHLKAIGYCPGSKALLEDCGIV CCCCCCHHHHHHHHHHCHHHHHHHHHHHHHCCHHHHHHHHHHHHCCCCCCHHHHHHCCEE FDDGIVPNEKWAKAAARRYWDRESNLRDLA EECCCCCCHHHHHHHHHHHHCCCCCCCCCC >Mature Secondary Structure SRRSIQSGKGKAGELHQTSSGPRDALTTNHGVRISDNQNSLRAGSVGPTLLEDFVLREK CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCEEEECCCCCCCCCCCCHHHHHHHHHHHH IFHFDHERIPERIVHARGSAAHGYFECTDAIPGLSRASLFSEKGKRTPVFTRFSTVAGGA HHHCCHHHHHHHHHHCCCCCCCCCEEEHHCCCCCHHHHHHHHCCCCCCEEEEHHHHCCCC GSVDTPRDVRGFAVKFYTDEGNWDLVGNNIPVFFIQDAIKFPDLIHSVKMEADRGFPQAA CCCCCCCCCCEEEEEEEECCCCEEEECCCCCEEEECCHHHHHHHHHHHHHHHCCCCCCCC SAHDTFWDFISLMPETMHTMIWAMSDRAIPRSYRMMEGFGVHTFRLVNAKGKSTFVKFHW CCHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHCCCCEEEEEEECCCCCEEEEEEE KPKLGLQSLVWDESAKLQGADNDFHRRDLWEAIDSGNFPEWNFGIQVISEKLAEELPYNV CCCCCHHHHHCCCCCCCCCCCCCHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHCCCCC LDPTKIVPEEIAPVRIIGRMVLDRNPDNHFAENEQAAFLPSNVVPGIDFTNDPLLQGRLF CCCCCCCHHHCCHHHHHHHHHHCCCCCCCCCCCCCCEECCCCCCCCCCCCCCCCHHHHHH SYLDTQKSRLGTTNFHQIPINAPKCPFANMQRDGMMQTFVPKGRANYEPNTLDEAGEAAG HHHHHHHHHCCCCCCEEECCCCCCCCCCCCCCCCCHHHHCCCCCCCCCCCCHHHHCCCCC PRASKEGFRTFESNTELGNSPTDKLRVRDETFGDHFSQPRMFWHSQTENEQAHIASALVF CCCCHHHHHHHCCCCCCCCCCCHHEEECCHHHHHCCCCCCEEECCCCCCCHHHHHHHHHH ELSKVGTEHIRKRTLSVIRNIDHDLAKRVADGLGLKVPAATPPFREPVDLGSSDSLSIQK HHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHCCCEECCCCCCCCCCCCCCCCCCCEEEEC NWQTTIRGRTVAILFAEGSDKDAIDELTSSIEGKGGSVYLVAPKVGPLKVKGGMLQADGQ CCHHEECCCEEEEEEECCCCHHHHHHHHHHHCCCCCEEEEEECCCCCEEECCCEEEECCC LAGSPSPLFDAVAMVLMPDQVEKLMKDSAARGWVSDAYSHLKAIGYCPGSKALLEDCGIV CCCCCCHHHHHHHHHHCHHHHHHHHHHHHHCCHHHHHHHHHHHHCCCCCCHHHHHHCCEE FDDGIVPNEKWAKAAARRYWDRESNLRDLA EECCCCCCHHHHHHHHHHHHCCCCCCCCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 10198032; 11481431 [H]