| Definition | Herpetosiphon aurantiacus ATCC 23779 chromosome, complete genome. |
|---|---|
| Accession | NC_009972 |
| Length | 6,346,587 |
Click here to switch to the map view.
The map label for this gene is yoaE [H]
Identifier: 159901185
GI number: 159901185
Start: 5969255
End: 5971327
Strand: Direct
Name: yoaE [H]
Synonym: Haur_4673
Alternate gene names: 159901185
Gene position: 5969255-5971327 (Clockwise)
Preceding gene: 159901182
Following gene: 159901186
Centisome position: 94.05
GC content: 52.29
Gene sequence:
>2073_bases ATGACAACGATTGCCCTTGATCAGCAGATTATTCATGCGGTTTGCCCCCACGATTGCCCCGATACCTGCTCGATGCTTGT AACCGTGCAGGATGGTAAGGCGATTAAGATTCAGGGCAACCCTGAGCACCCTATAACCAATGGTTTTTTGTGCACCAAAG TCTCGCGCTATGTTGAGCGTACCTACCACCAAGGCCGGTTGTTGTATCCGGCCAAGCGGGTTGGTCCCAAGGGTGCAGGC CAATTCGAACGGATCTCGTGGGACGAAGCCTTAACAACCATCGCCGAATGTTTGCAAGCAATCAGCACTAGCCATGGCCC GCAATCAATTTTGCCCTACTCCTATGCTGGCACTATGGGTTTGCTGCATTATGGCTCGATGGATCGACGCTTTTTCCATC GTTTGGGCGCTTCATTGCTCGACCGCACGATTTGTGCCAGCGCTGGGGCAACTGGCTATCGCTATACGGTTGGCGCGAGT GTTGGCACTGACCCCGAGGCCTATGTTGATGCCAAATTAATTATTTTGTGGGGAACCAACACACTCACGTCGAATGTGCA CTTGTGGACCTTCATCAAGGCGGCACGTAAAGCTGGCGCACGGGTGATTGCGATCGATCCTTGGCGTTCGCGCACTGCCG CCCAATGCGATTGGCATATTGCACCTTTGCCAGGCACTGATGCTGCCTTGGCGCTGGGCATGATGCATATTATTTTTCGT GATGGCTTGCAGGATCAAGCCTATCTTGATGAATATTGTCTTGGTGGCGAACAATTGCGCCAGCGCGTGCAGGAATATCC GCCAGAGCTTGTGGCCGAATTGACTGGTTTGGATGTCGCAACGATTGAGCAATTGGCCCACGAATATGCTACGACTGCAC CCGCTGCGATTCGGATTAATTATGGCTTGCAACGCCACGCTGGCGGCGGCATGGCCGTGCGTACTTTGGCTTGTTTGCCT GCGGTAATCGGTTCGTGGCGTGAGCGAGCAGGCGGCATTTTGCTTTCCACTAGCGGCACATTTCCAATTAATAATGCGGC CTTGGAGCGCCCTGATCTGATTCCTGCTGGCACTCGCATGATCAATATGAATCAGCTTGGTGATGCCCTGACCGAATTAA ACGACCCGCCAGTGCAAGCTTTGTTTGTCTACAATTCTAATCCGGCGAGCGTGGCCCCCGATTTGGAAGCAGTCAAGCGT GGCTTGGAGCGCGAAGATTTGTTCACGGTGGTGCACGAGCAGTTTTACACCGACACGACGCGCTACGCTGATATTATTTT GCCTGCAACCACCCAACTAGAGCATGTAGATTTACATAAAGCCTATGGTCACTGGTATTTAGCTTGGAGCAACCAAGCGA TTGAGCCGCTAGGCGAGGCGATTCCGAATACCGAGTTGTTTCGGCGCTTGGCGGCCAAAATGGGCTTTAGCGAGCCATGT TTTAGCGATGATGATCAAACGATCGCTCGCCAAGCACTCAATTCAAATCATCCAGCCTTGGCAGGCATTACCCTCGAACG TTTGCAAGAAGCGGGTTGGCTGCGTTTAAATGTACCAAGCAATTGGGCACCGTTTGCTGAGGGCAATTTTCTCACACCAT CGGGCAAGTGCGAACTCTATTCTGAACGGATGTTGGCTGATGGTTTTGATCCATTGCCGACCTATACCGCGCCTTACGAA AGCCCAGTGACTAACCCACGTTTGGCTGAGCGCTATCCATTGACCCTAATTTCGCCGCCAGCCCATCACTTTTTAAATAG CACCTTTGGCAATATTTTGCAGCGCTACGAAAGTGGCCCGACCCTAGAAATTAATCCACTTGATGCGATTGAGCGCAATA TCGACGATGGCGATCAAGTATTGATTCGCAACGATCGTGGCGGTTTTGTGGCAACAGCAGTGGTGACTGATCGGGTGCGG CAAGCTGTGGTGGTTGCGCCATCAATTTGGTGGTCGGAGCTAACCGTCGATGGCCGCAACGTCAACCATACCACACCCCA AGCGCTTTCGGATATGGGCGGCGGTGCAACGTTCTACGATAATTTGGTTGAGGTTGAGCGTATTGTCAGCTAA
Upstream 100 bases:
>100_bases TCCATAACATGCAGCTGATAATTCGTTGAAAAAAACGAAAAGTTGTATAGTAGTTGGCAACAACTGCGAAGGAGGCGGGT TTTTCAGCCCGATTGATGCC
Downstream 100 bases:
>100_bases GCTATGTGGTTGCTGGTATATTCGTGGTTAGCGTAACGATACCCAAACGTTGAGGAGTGTGTATGAGTTTTTTGCGTAAG CTTTTTGGCAGTAGCAGCCA
Product: molybdopterin oxidoreductase
Products: Reduced form of N-Oxide compounds [C]
Alternate protein names: NA
Number of amino acids: Translated: 690; Mature: 689
Protein sequence:
>690_residues MTTIALDQQIIHAVCPHDCPDTCSMLVTVQDGKAIKIQGNPEHPITNGFLCTKVSRYVERTYHQGRLLYPAKRVGPKGAG QFERISWDEALTTIAECLQAISTSHGPQSILPYSYAGTMGLLHYGSMDRRFFHRLGASLLDRTICASAGATGYRYTVGAS VGTDPEAYVDAKLIILWGTNTLTSNVHLWTFIKAARKAGARVIAIDPWRSRTAAQCDWHIAPLPGTDAALALGMMHIIFR DGLQDQAYLDEYCLGGEQLRQRVQEYPPELVAELTGLDVATIEQLAHEYATTAPAAIRINYGLQRHAGGGMAVRTLACLP AVIGSWRERAGGILLSTSGTFPINNAALERPDLIPAGTRMINMNQLGDALTELNDPPVQALFVYNSNPASVAPDLEAVKR GLEREDLFTVVHEQFYTDTTRYADIILPATTQLEHVDLHKAYGHWYLAWSNQAIEPLGEAIPNTELFRRLAAKMGFSEPC FSDDDQTIARQALNSNHPALAGITLERLQEAGWLRLNVPSNWAPFAEGNFLTPSGKCELYSERMLADGFDPLPTYTAPYE SPVTNPRLAERYPLTLISPPAHHFLNSTFGNILQRYESGPTLEINPLDAIERNIDDGDQVLIRNDRGGFVATAVVTDRVR QAVVVAPSIWWSELTVDGRNVNHTTPQALSDMGGGATFYDNLVEVERIVS
Sequences:
>Translated_690_residues MTTIALDQQIIHAVCPHDCPDTCSMLVTVQDGKAIKIQGNPEHPITNGFLCTKVSRYVERTYHQGRLLYPAKRVGPKGAG QFERISWDEALTTIAECLQAISTSHGPQSILPYSYAGTMGLLHYGSMDRRFFHRLGASLLDRTICASAGATGYRYTVGAS VGTDPEAYVDAKLIILWGTNTLTSNVHLWTFIKAARKAGARVIAIDPWRSRTAAQCDWHIAPLPGTDAALALGMMHIIFR DGLQDQAYLDEYCLGGEQLRQRVQEYPPELVAELTGLDVATIEQLAHEYATTAPAAIRINYGLQRHAGGGMAVRTLACLP AVIGSWRERAGGILLSTSGTFPINNAALERPDLIPAGTRMINMNQLGDALTELNDPPVQALFVYNSNPASVAPDLEAVKR GLEREDLFTVVHEQFYTDTTRYADIILPATTQLEHVDLHKAYGHWYLAWSNQAIEPLGEAIPNTELFRRLAAKMGFSEPC FSDDDQTIARQALNSNHPALAGITLERLQEAGWLRLNVPSNWAPFAEGNFLTPSGKCELYSERMLADGFDPLPTYTAPYE SPVTNPRLAERYPLTLISPPAHHFLNSTFGNILQRYESGPTLEINPLDAIERNIDDGDQVLIRNDRGGFVATAVVTDRVR QAVVVAPSIWWSELTVDGRNVNHTTPQALSDMGGGATFYDNLVEVERIVS >Mature_689_residues TTIALDQQIIHAVCPHDCPDTCSMLVTVQDGKAIKIQGNPEHPITNGFLCTKVSRYVERTYHQGRLLYPAKRVGPKGAGQ FERISWDEALTTIAECLQAISTSHGPQSILPYSYAGTMGLLHYGSMDRRFFHRLGASLLDRTICASAGATGYRYTVGASV GTDPEAYVDAKLIILWGTNTLTSNVHLWTFIKAARKAGARVIAIDPWRSRTAAQCDWHIAPLPGTDAALALGMMHIIFRD GLQDQAYLDEYCLGGEQLRQRVQEYPPELVAELTGLDVATIEQLAHEYATTAPAAIRINYGLQRHAGGGMAVRTLACLPA VIGSWRERAGGILLSTSGTFPINNAALERPDLIPAGTRMINMNQLGDALTELNDPPVQALFVYNSNPASVAPDLEAVKRG LEREDLFTVVHEQFYTDTTRYADIILPATTQLEHVDLHKAYGHWYLAWSNQAIEPLGEAIPNTELFRRLAAKMGFSEPCF SDDDQTIARQALNSNHPALAGITLERLQEAGWLRLNVPSNWAPFAEGNFLTPSGKCELYSERMLADGFDPLPTYTAPYES PVTNPRLAERYPLTLISPPAHHFLNSTFGNILQRYESGPTLEINPLDAIERNIDDGDQVLIRNDRGGFVATAVVTDRVRQ AVVVAPSIWWSELTVDGRNVNHTTPQALSDMGGGATFYDNLVEVERIVS
Specific function: Terminal Reductase During Anaerobic Growth On Various Sulfoxide And N-Oxide Compounds. Allows E.Coli To Grow Anaerobically On Me(2)So As Respiratory Oxidant. [C]
COG id: COG0243
COG function: function code C; Anaerobic dehydrogenases, typically selenocysteine-containing
Gene ontology:
Cell location: Cytoplasm Face Of The Membrane [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the prokaryotic molybdopterin-containing oxidoreductase family [H]
Homologues:
Organism=Escherichia coli, GI87081797, Length=767, Percent_Identity=29.2046936114733, Blast_Score=222, Evalue=6e-59, Organism=Escherichia coli, GI1787870, Length=770, Percent_Identity=27.012987012987, Blast_Score=204, Evalue=1e-53, Organism=Escherichia coli, GI171474008, Length=774, Percent_Identity=26.6149870801034, Blast_Score=198, Evalue=7e-52, Organism=Escherichia coli, GI3868721, Length=683, Percent_Identity=25.4758418740849, Blast_Score=163, Evalue=3e-41, Organism=Escherichia coli, GI145693196, Length=688, Percent_Identity=27.1802325581395, Blast_Score=153, Evalue=4e-38, Organism=Escherichia coli, GI87081994, Length=733, Percent_Identity=26.0572987721692, Blast_Score=143, Evalue=3e-35, Organism=Escherichia coli, GI1787231, Length=689, Percent_Identity=25.3991291727141, Blast_Score=139, Evalue=6e-34, Organism=Escherichia coli, GI1788534, Length=802, Percent_Identity=20.6982543640898, Blast_Score=79, Evalue=8e-16, Organism=Escherichia coli, GI3868720, Length=393, Percent_Identity=23.1552162849873, Blast_Score=78, Evalue=2e-15, Organism=Escherichia coli, GI3868719, Length=406, Percent_Identity=22.9064039408867, Blast_Score=71, Evalue=2e-13, Organism=Escherichia coli, GI1787741, Length=184, Percent_Identity=29.8913043478261, Blast_Score=68, Evalue=2e-12, Organism=Escherichia coli, GI1787477, Length=279, Percent_Identity=24.0143369175627, Blast_Score=68, Evalue=2e-12,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR009010 - InterPro: IPR006657 - InterPro: IPR006656 - InterPro: IPR006963 - InterPro: IPR006655 [H]
Pfam domain/function: PF04879 Molybdop_Fe4S4; PF00384 Molybdopterin; PF01568 Molydop_binding [H]
EC number: 1.8.99.- [C]
Molecular weight: Translated: 75906; Mature: 75775
Theoretical pI: Translated: 5.45; Mature: 5.45
Prosite motif: PS00490 MOLYBDOPTERIN_PROK_2
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.6 %Cys (Translated Protein) 1.7 %Met (Translated Protein) 3.3 %Cys+Met (Translated Protein) 1.6 %Cys (Mature Protein) 1.6 %Met (Mature Protein) 3.2 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MTTIALDQQIIHAVCPHDCPDTCSMLVTVQDGKAIKIQGNPEHPITNGFLCTKVSRYVER CCEEHHHHHHHHHHCCCCCCCCEEEEEEEECCCEEEEECCCCCCCCCCHHHHHHHHHHHH TYHQGRLLYPAKRVGPKGAGQFERISWDEALTTIAECLQAISTSHGPQSILPYSYAGTMG HHHCCEEECCHHHCCCCCCCCCCCCCHHHHHHHHHHHHHHHHCCCCCCCCCCCCHHCHHH LLHYGSMDRRFFHRLGASLLDRTICASAGATGYRYTVGASVGTDPEAYVDAKLIILWGTN HHHCCCHHHHHHHHHHHHHHHHHHHHCCCCCCEEEEECCCCCCCCCCEECEEEEEEECCC TLTSNVHLWTFIKAARKAGARVIAIDPWRSRTAAQCDWHIAPLPGTDAALALGMMHIIFR CCCCCCHHHHHHHHHHHCCCEEEEECCCCCCCCCCCCEEEECCCCCHHHHHHHHHHHHHH DGLQDQAYLDEYCLGGEQLRQRVQEYPPELVAELTGLDVATIEQLAHEYATTAPAAIRIN CCCCHHHHHHHHHCCHHHHHHHHHHCCHHHHHHHHCCCHHHHHHHHHHHHCCCCEEEEEE YGLQRHAGGGMAVRTLACLPAVIGSWRERAGGILLSTSGTFPINNAALERPDLIPAGTRM CCEEECCCCCHHHHHHHHHHHHHHHHHHHHCCEEEECCCCCCCCCCCCCCCCCCCCCCEE INMNQLGDALTELNDPPVQALFVYNSNPASVAPDLEAVKRGLEREDLFTVVHEQFYTDTT EEHHHHHHHHHHCCCCCEEEEEEECCCCCCCCCCHHHHHCCCCHHHHHHHHHHHHHCCCH RYADIILPATTQLEHVDLHKAYGHWYLAWSNQAIEPLGEAIPNTELFRRLAAKMGFSEPC HHEEEEECCCCCCHHHHHHHHCCCEEEEECCCHHHHHHHHCCCHHHHHHHHHHCCCCCCC FSDDDQTIARQALNSNHPALAGITLERLQEAGWLRLNVPSNWAPFAEGNFLTPSGKCELY CCCCHHHHHHHHHCCCCCEEEHHHHHHHHHCCEEEEECCCCCCCCCCCCEECCCCCCHHH SERMLADGFDPLPTYTAPYESPVTNPRLAERYPLTLISPPAHHFLNSTFGNILQRYESGP HHHHHHCCCCCCCCCCCCCCCCCCCCCCHHHCCEEEECCCHHHHHHHHHHHHHHHHCCCC TLEINPLDAIERNIDDGDQVLIRNDRGGFVATAVVTDRVRQAVVVAPSIWWSELTVDGRN EEEECCHHHHHCCCCCCCEEEEEECCCCEEEEHHHHHHHHHEEEEECCCCEEHEEECCCC VNHTTPQALSDMGGGATFYDNLVEVERIVS CCCCCHHHHHHCCCCHHHHHHHHHHHHHCC >Mature Secondary Structure TTIALDQQIIHAVCPHDCPDTCSMLVTVQDGKAIKIQGNPEHPITNGFLCTKVSRYVER CEEHHHHHHHHHHCCCCCCCCEEEEEEEECCCEEEEECCCCCCCCCCHHHHHHHHHHHH TYHQGRLLYPAKRVGPKGAGQFERISWDEALTTIAECLQAISTSHGPQSILPYSYAGTMG HHHCCEEECCHHHCCCCCCCCCCCCCHHHHHHHHHHHHHHHHCCCCCCCCCCCCHHCHHH LLHYGSMDRRFFHRLGASLLDRTICASAGATGYRYTVGASVGTDPEAYVDAKLIILWGTN HHHCCCHHHHHHHHHHHHHHHHHHHHCCCCCCEEEEECCCCCCCCCCEECEEEEEEECCC TLTSNVHLWTFIKAARKAGARVIAIDPWRSRTAAQCDWHIAPLPGTDAALALGMMHIIFR CCCCCCHHHHHHHHHHHCCCEEEEECCCCCCCCCCCCEEEECCCCCHHHHHHHHHHHHHH DGLQDQAYLDEYCLGGEQLRQRVQEYPPELVAELTGLDVATIEQLAHEYATTAPAAIRIN CCCCHHHHHHHHHCCHHHHHHHHHHCCHHHHHHHHCCCHHHHHHHHHHHHCCCCEEEEEE YGLQRHAGGGMAVRTLACLPAVIGSWRERAGGILLSTSGTFPINNAALERPDLIPAGTRM CCEEECCCCCHHHHHHHHHHHHHHHHHHHHCCEEEECCCCCCCCCCCCCCCCCCCCCCEE INMNQLGDALTELNDPPVQALFVYNSNPASVAPDLEAVKRGLEREDLFTVVHEQFYTDTT EEHHHHHHHHHHCCCCCEEEEEEECCCCCCCCCCHHHHHCCCCHHHHHHHHHHHHHCCCH RYADIILPATTQLEHVDLHKAYGHWYLAWSNQAIEPLGEAIPNTELFRRLAAKMGFSEPC HHEEEEECCCCCCHHHHHHHHCCCEEEEECCCHHHHHHHHCCCHHHHHHHHHHCCCCCCC FSDDDQTIARQALNSNHPALAGITLERLQEAGWLRLNVPSNWAPFAEGNFLTPSGKCELY CCCCHHHHHHHHHCCCCCEEEHHHHHHHHHCCEEEEECCCCCCCCCCCCEECCCCCCHHH SERMLADGFDPLPTYTAPYESPVTNPRLAERYPLTLISPPAHHFLNSTFGNILQRYESGP HHHHHHCCCCCCCCCCCCCCCCCCCCCCHHHCCEEEECCCHHHHHHHHHHHHHHHHCCCC TLEINPLDAIERNIDDGDQVLIRNDRGGFVATAVVTDRVRQAVVVAPSIWWSELTVDGRN EEEECCHHHHHCCCCCCCEEEEEECCCCEEEEHHHHHHHHHEEEEECCCCEEHEEECCCC VNHTTPQALSDMGGGATFYDNLVEVERIVS CCCCCHHHHHHCCCCHHHHHHHHHHHHHCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: May Bind 4Fe-4S Cluster. [C]
Metal ions: Fe; Mo [C]
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: N-Oxide; Sulfoxide Compounds Including Trimethylamine N-Oxide. [C]
Specific reaction: Reduces Various N-Oxide And Sulfoxide Compounds Including Trimethylamine N-Oxide. [C]
General reaction: Oxidoreductases [C]
Inhibitor: NA
Structure determination priority: 6.0
TargetDB status: NA
Availability: NA
References: 9384377 [H]