Definition Novosphingobium aromaticivorans DSM 12444 chromosome, complete genome.
Accession NC_007794
Length 3,561,584

Click here to switch to the map view.

The map label for this gene is yyaE [H]

Identifier: 87200789

GI number: 87200789

Start: 2995464

End: 2997527

Strand: Direct

Name: yyaE [H]

Synonym: Saro_2776

Alternate gene names: 87200789

Gene position: 2995464-2997527 (Clockwise)

Preceding gene: 87200783

Following gene: 87200790

Centisome position: 84.1

GC content: 67.34

Gene sequence:

>2064_bases
ATGCCACAGGTCCATCATCGCACGTGCCATATCTGCGAGGCCAATTGCGGCGTTCTGGTGGAAGTGGACGGGCGCCGGAT
TCTGTCCATCCGTGGCGATCCCGACAACCCGCTGTCGCGCGGACACATCTGCCCCAAGGGCACGGCCCTGCAAGACCTTC
AGGAGGATCCCGACCGGCTGCGCCGCCCGCTCAAGCGGGTGGGAGACACCTGGCACGAGATCAGCTTCGAGCAGGCCTTC
GCCGAAATCGGAGAGCGGACACGCGCAATCCTGGCGAAGGACCCCGACAGCGCCGCCGTCTATATCGGCAATCCCAACGC
GCACAGCTATGGGAACGCGCTCAATGCGGACTTTCTGGGCAAGGCCCTGCGGACGCGAAACAAGTTCTCGGCCAGCACGG
TCGACCAGATGCCTCATCAGGTGGCGAACCTGCGGCTGTGGGGCCATGCCAGCATGTTCCCGATTCCCGACATCGACCGG
ACGCGCACGCTTGTCATCCTCGGGGGCAACCCCATGGCATCGAACGGCTCGCTCTGGACCGTGCCGGATTTCCGCGCGCG
CGTTCGCGACCTCAAGGCGCGCGGCGGCGAACTGATCGTGATCGACCCGCGTCGGACGGAGACCGCAAAAATTGCGGACC
GCCATCTCTTCATCCGGCCGGCGGGCGATGTGTACTTCCTGATCGCACTCCTCAAGGCCGTGCGGGCGCGATCGCCCGCC
CGCGTTGTGCAGGACTTCGTGACCGGTCTCGACCGGGTGGACGAGGCGCTGCAACGTTTCGACGCCGAGGCTTGCGCAGC
GTCCTGCGGGGTTCCCTTGCCCGAGATCGAGGCTCTGGCCGAAAGGTTCCTGGCGGGTCCCGCCGCGCTCTATGGCCGAA
TGGGCGTGGCGACCCAAGCGCACGGAACGCTCAACGCTTGGCTGATCTCGCTGGTCAACATCGCGTCAGGGCAACTCGAC
CGCGAAGGAGGCTGGGTGTTCGGCCTTCCCGCCGTCGACACGGTCAACGTCCTTCCGCCCGGATCGATCGGCAAGTTCGC
ATCGCGCGTTTCCGGGCATCGCTCGGTGCTTGGCGAGTTGCCCGCTGCCGCGATGGCCGAAGAGATCGAAACTCCCGGCG
AAGGGCGGATCAGGGCGCTGTTCGTCGTCGCCGGGAATCCGGTGCTGTCCACACCCAACGGCGCGCGGCTCGACAAGGCG
CTCGAGTGCCTCGACCTGCTGGTTTCGATCGACATCTATCGCAATGCCACCAGTCGGCGCGCGCACTACATCCTGCCACC
GGCCGGACCGCTCGAGCGCGACCATTACGGCCTGTTCCTCCTGCCGATGGCCGCGCGGACGATCGCAGTCTATTCCCGGC
CCACGCTGGAGCAGGAAGAGGGATCGCTGCACGACTGGGAAATCCTGCGCGGCCTTGCCCACGCGATCAGCGGCGAACCC
GTACAGGCGCCAACCCCGCGCGAGGCGCTGGACGGATTGCTGCGGTCCGGGCCTTACGGATTGACGCTCGAACAGGTGGA
AGCATCGCCATCGGGTATCGACCTCGGCCCTCCGCCGACCGGTCAGTTGCCCGGTCGCCTGCGTACGCCGGACAAGCGCG
TCACCTGCGACGTGGAGGAATTGGTCGAAGCTCTCGGCGCGCTCGACCTGCCCGGACAGGAGGACCCGCAAGGGGGACTG
CGCCTCATCGGAAGGCGGCACTTGCGCACGAACAACTCCTGGCTCGCCAACAGCCGCCGCCTGATCAAGGGGCCGGACCG
CTGCACGGTGATGATCCACCCGGACGACGCGACCCCGCGCGGCATCGCCGATGGCGCGACGGTGACGGTGCGCTCCGTCG
CGGGCAGCATCGCGCTCGCCGCCGAGGTGACCGACGACATGATGCCGGGGACCGTTTCCATACCGCACGGCTGGGGCCAC
GGCCTGCCGGGCGTATCGATGGAGAACGCCCTGGGTCGGCCCGGCGTCAGCGTCAACGACATCACGCTGGAAACCGCGAT
GGATCCGCTTTCCGGCAACGCCGCGTTTTCGGGCGTGGAGGTCGAGGTGGCCCTGGCGGGTTGA

Upstream 100 bases:

>100_bases
GATACCTTCACCTCTCCCGGAGACACGTGATTTCTCTTGCCTCGAGGGGCCCGCGATGCGAGATTTAATCGATCAACTAA
AATGTACCGGGAGAATTGCG

Downstream 100 bases:

>100_bases
TGCCGGTCAAGGCGGCCCTTCGCGCAACCTGCCATCGCTCCGGCAACGGAGAGGAAGGCCGATGGCGACAATGGCTGTGA
CCGTGGGCGACCACGACGCG

Product: molydopterin dinucleotide-binding region

Products: CO2; NADH; H2 [C]

Alternate protein names: NA

Number of amino acids: Translated: 687; Mature: 686

Protein sequence:

>687_residues
MPQVHHRTCHICEANCGVLVEVDGRRILSIRGDPDNPLSRGHICPKGTALQDLQEDPDRLRRPLKRVGDTWHEISFEQAF
AEIGERTRAILAKDPDSAAVYIGNPNAHSYGNALNADFLGKALRTRNKFSASTVDQMPHQVANLRLWGHASMFPIPDIDR
TRTLVILGGNPMASNGSLWTVPDFRARVRDLKARGGELIVIDPRRTETAKIADRHLFIRPAGDVYFLIALLKAVRARSPA
RVVQDFVTGLDRVDEALQRFDAEACAASCGVPLPEIEALAERFLAGPAALYGRMGVATQAHGTLNAWLISLVNIASGQLD
REGGWVFGLPAVDTVNVLPPGSIGKFASRVSGHRSVLGELPAAAMAEEIETPGEGRIRALFVVAGNPVLSTPNGARLDKA
LECLDLLVSIDIYRNATSRRAHYILPPAGPLERDHYGLFLLPMAARTIAVYSRPTLEQEEGSLHDWEILRGLAHAISGEP
VQAPTPREALDGLLRSGPYGLTLEQVEASPSGIDLGPPPTGQLPGRLRTPDKRVTCDVEELVEALGALDLPGQEDPQGGL
RLIGRRHLRTNNSWLANSRRLIKGPDRCTVMIHPDDATPRGIADGATVTVRSVAGSIALAAEVTDDMMPGTVSIPHGWGH
GLPGVSMENALGRPGVSVNDITLETAMDPLSGNAAFSGVEVEVALAG

Sequences:

>Translated_687_residues
MPQVHHRTCHICEANCGVLVEVDGRRILSIRGDPDNPLSRGHICPKGTALQDLQEDPDRLRRPLKRVGDTWHEISFEQAF
AEIGERTRAILAKDPDSAAVYIGNPNAHSYGNALNADFLGKALRTRNKFSASTVDQMPHQVANLRLWGHASMFPIPDIDR
TRTLVILGGNPMASNGSLWTVPDFRARVRDLKARGGELIVIDPRRTETAKIADRHLFIRPAGDVYFLIALLKAVRARSPA
RVVQDFVTGLDRVDEALQRFDAEACAASCGVPLPEIEALAERFLAGPAALYGRMGVATQAHGTLNAWLISLVNIASGQLD
REGGWVFGLPAVDTVNVLPPGSIGKFASRVSGHRSVLGELPAAAMAEEIETPGEGRIRALFVVAGNPVLSTPNGARLDKA
LECLDLLVSIDIYRNATSRRAHYILPPAGPLERDHYGLFLLPMAARTIAVYSRPTLEQEEGSLHDWEILRGLAHAISGEP
VQAPTPREALDGLLRSGPYGLTLEQVEASPSGIDLGPPPTGQLPGRLRTPDKRVTCDVEELVEALGALDLPGQEDPQGGL
RLIGRRHLRTNNSWLANSRRLIKGPDRCTVMIHPDDATPRGIADGATVTVRSVAGSIALAAEVTDDMMPGTVSIPHGWGH
GLPGVSMENALGRPGVSVNDITLETAMDPLSGNAAFSGVEVEVALAG
>Mature_686_residues
PQVHHRTCHICEANCGVLVEVDGRRILSIRGDPDNPLSRGHICPKGTALQDLQEDPDRLRRPLKRVGDTWHEISFEQAFA
EIGERTRAILAKDPDSAAVYIGNPNAHSYGNALNADFLGKALRTRNKFSASTVDQMPHQVANLRLWGHASMFPIPDIDRT
RTLVILGGNPMASNGSLWTVPDFRARVRDLKARGGELIVIDPRRTETAKIADRHLFIRPAGDVYFLIALLKAVRARSPAR
VVQDFVTGLDRVDEALQRFDAEACAASCGVPLPEIEALAERFLAGPAALYGRMGVATQAHGTLNAWLISLVNIASGQLDR
EGGWVFGLPAVDTVNVLPPGSIGKFASRVSGHRSVLGELPAAAMAEEIETPGEGRIRALFVVAGNPVLSTPNGARLDKAL
ECLDLLVSIDIYRNATSRRAHYILPPAGPLERDHYGLFLLPMAARTIAVYSRPTLEQEEGSLHDWEILRGLAHAISGEPV
QAPTPREALDGLLRSGPYGLTLEQVEASPSGIDLGPPPTGQLPGRLRTPDKRVTCDVEELVEALGALDLPGQEDPQGGLR
LIGRRHLRTNNSWLANSRRLIKGPDRCTVMIHPDDATPRGIADGATVTVRSVAGSIALAAEVTDDMMPGTVSIPHGWGHG
LPGVSMENALGRPGVSVNDITLETAMDPLSGNAAFSGVEVEVALAG

Specific function: Decomposes Formic Acid To Hydrogen And Carbon Dioxide Under Anaerobic Conditions In The Absence Of Exogenous Electron Acceptors. [C]

COG id: COG0243

COG function: function code C; Anaerobic dehydrogenases, typically selenocysteine-containing

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the prokaryotic molybdopterin-containing oxidoreductase family [H]

Homologues:

Organism=Escherichia coli, GI3868721, Length=677, Percent_Identity=23.6336779911374, Blast_Score=110, Evalue=3e-25,
Organism=Escherichia coli, GI87081994, Length=719, Percent_Identity=22.9485396383866, Blast_Score=96, Evalue=8e-21,
Organism=Escherichia coli, GI3868720, Length=254, Percent_Identity=31.8897637795276, Blast_Score=92, Evalue=1e-19,
Organism=Escherichia coli, GI3868719, Length=248, Percent_Identity=29.4354838709677, Blast_Score=90, Evalue=6e-19,
Organism=Escherichia coli, GI1788534, Length=497, Percent_Identity=20.7243460764588, Blast_Score=75, Evalue=1e-14,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR009010
- InterPro:   IPR006657
- InterPro:   IPR006656
- InterPro:   IPR006963 [H]

Pfam domain/function: PF04879 Molybdop_Fe4S4; PF00384 Molybdopterin; PF01568 Molydop_binding [H]

EC number: 1.2.1.2 [C]

Molecular weight: Translated: 73849; Mature: 73718

Theoretical pI: Translated: 6.39; Mature: 6.39

Prosite motif: PS00932 MOLYBDOPTERIN_PROK_3

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.3 %Cys     (Translated Protein)
1.7 %Met     (Translated Protein)
3.1 %Cys+Met (Translated Protein)
1.3 %Cys     (Mature Protein)
1.6 %Met     (Mature Protein)
2.9 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MPQVHHRTCHICEANCGVLVEVDGRRILSIRGDPDNPLSRGHICPKGTALQDLQEDPDRL
CCCCCCCEEEEEECCCCEEEEECCCEEEEEECCCCCCCCCCCCCCCCCHHHHHHCCHHHH
RRPLKRVGDTWHEISFEQAFAEIGERTRAILAKDPDSAAVYIGNPNAHSYGNALNADFLG
HHHHHHHCCHHHHHHHHHHHHHHHHHHHEEEEECCCCCEEEEECCCCCCCCCCCCHHHHH
KALRTRNKFSASTVDQMPHQVANLRLWGHASMFPIPDIDRTRTLVILGGNPMASNGSLWT
HHHHHCCCCCHHHHHHHHHHHHCEEEECCCCCCCCCCCCCCEEEEEECCCCCCCCCCEEE
VPDFRARVRDLKARGGELIVIDPRRTETAKIADRHLFIRPAGDVYFLIALLKAVRARSPA
CCHHHHHHHHHHHCCCEEEEECCCCCCHHHHCCCEEEEECCCHHHHHHHHHHHHHCCCHH
RVVQDFVTGLDRVDEALQRFDAEACAASCGVPLPEIEALAERFLAGPAALYGRMGVATQA
HHHHHHHHHHHHHHHHHHHHCHHHHHHHCCCCCHHHHHHHHHHHCCHHHHHHCCCCCCCC
HGTLNAWLISLVNIASGQLDREGGWVFGLPAVDTVNVLPPGSIGKFASRVSGHRSVLGEL
CCHHHHHHHHHHHHHCCCEECCCCEEEECCCCCEEECCCCCCHHHHHHHHHHHHHHHHHC
PAAAMAEEIETPGEGRIRALFVVAGNPVLSTPNGARLDKALECLDLLVSIDIYRNATSRR
CHHHHHHHHCCCCCCCEEEEEEEECCCEEECCCCHHHHHHHHHHHHHHHHHHHHCCCCCC
AHYILPPAGPLERDHYGLFLLPMAARTIAVYSRPTLEQEEGSLHDWEILRGLAHAISGEP
CEEECCCCCCCCCCCCCEEEEEHHHHEEEEECCCCCCCCCCCCHHHHHHHHHHHHHCCCC
VQAPTPREALDGLLRSGPYGLTLEQVEASPSGIDLGPPPTGQLPGRLRTPDKRVTCDVEE
CCCCCCHHHHHHHHHCCCCCCCHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCEEECHHH
LVEALGALDLPGQEDPQGGLRLIGRRHLRTNNSWLANSRRLIKGPDRCTVMIHPDDATPR
HHHHHCCCCCCCCCCCCCHHHHHHHHHHCCCCCEECCCCCEECCCCEEEEEEECCCCCCC
GIADGATVTVRSVAGSIALAAEVTDDMMPGTVSIPHGWGHGLPGVSMENALGRPGVSVND
CCCCCCEEEEEECCCCEEEEEHHHHCCCCCEEECCCCCCCCCCCCCHHHHCCCCCCCEEE
ITLETAMDPLSGNAAFSGVEVEVALAG
EEHHHHCCCCCCCCEECCEEEEEEECC
>Mature Secondary Structure 
PQVHHRTCHICEANCGVLVEVDGRRILSIRGDPDNPLSRGHICPKGTALQDLQEDPDRL
CCCCCCEEEEEECCCCEEEEECCCEEEEEECCCCCCCCCCCCCCCCCHHHHHHCCHHHH
RRPLKRVGDTWHEISFEQAFAEIGERTRAILAKDPDSAAVYIGNPNAHSYGNALNADFLG
HHHHHHHCCHHHHHHHHHHHHHHHHHHHEEEEECCCCCEEEEECCCCCCCCCCCCHHHHH
KALRTRNKFSASTVDQMPHQVANLRLWGHASMFPIPDIDRTRTLVILGGNPMASNGSLWT
HHHHHCCCCCHHHHHHHHHHHHCEEEECCCCCCCCCCCCCCEEEEEECCCCCCCCCCEEE
VPDFRARVRDLKARGGELIVIDPRRTETAKIADRHLFIRPAGDVYFLIALLKAVRARSPA
CCHHHHHHHHHHHCCCEEEEECCCCCCHHHHCCCEEEEECCCHHHHHHHHHHHHHCCCHH
RVVQDFVTGLDRVDEALQRFDAEACAASCGVPLPEIEALAERFLAGPAALYGRMGVATQA
HHHHHHHHHHHHHHHHHHHHCHHHHHHHCCCCCHHHHHHHHHHHCCHHHHHHCCCCCCCC
HGTLNAWLISLVNIASGQLDREGGWVFGLPAVDTVNVLPPGSIGKFASRVSGHRSVLGEL
CCHHHHHHHHHHHHHCCCEECCCCEEEECCCCCEEECCCCCCHHHHHHHHHHHHHHHHHC
PAAAMAEEIETPGEGRIRALFVVAGNPVLSTPNGARLDKALECLDLLVSIDIYRNATSRR
CHHHHHHHHCCCCCCCEEEEEEEECCCEEECCCCHHHHHHHHHHHHHHHHHHHHCCCCCC
AHYILPPAGPLERDHYGLFLLPMAARTIAVYSRPTLEQEEGSLHDWEILRGLAHAISGEP
CEEECCCCCCCCCCCCCEEEEEHHHHEEEEECCCCCCCCCCCCHHHHHHHHHHHHHCCCC
VQAPTPREALDGLLRSGPYGLTLEQVEASPSGIDLGPPPTGQLPGRLRTPDKRVTCDVEE
CCCCCCHHHHHHHHHCCCCCCCHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCEEECHHH
LVEALGALDLPGQEDPQGGLRLIGRRHLRTNNSWLANSRRLIKGPDRCTVMIHPDDATPR
HHHHHCCCCCCCCCCCCCHHHHHHHHHHCCCCCEECCCCCEECCCCEEEEEEECCCCCCC
GIADGATVTVRSVAGSIALAAEVTDDMMPGTVSIPHGWGHGLPGVSMENALGRPGVSVND
CCCCCCEEEEEECCCCEEEEEHHHHCCCCCEEECCCCCCCCCCCCCHHHHCCCCCCCEEE
ITLETAMDPLSGNAAFSGVEVEVALAG
EEHHHHCCCCCCCCEECCEEEEEEECC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NAD+ [C]

Metal ions: Fe; Mo; Se [C]

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): 0.19 {3-pyridinecarboxaldehyde-NAD+}} 0.032 {NAD+}} 1.16 {3-acetylpyridine-NAD+}} 0.54 {deamino-NAD+}} 0.17 {thio-NAD+}} [C]

Substrates: Formate; NAD(+) [C]

Specific reaction: Formate + NAD(+) = CO2 + NADH. formate = CO2 + H2 [C]

General reaction: Redox reaction [C]

Inhibitor: Azide; Br-; Cl-; CN-; F-; HCO3-; HCOS-; NO2-; NO3-; OCN-; SCN- [C]

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 7584024; 9384377; 1552862 [H]