Definition Symbiobacterium thermophilum IAM 14863 chromosome, complete genome.
Accession NC_006177
Length 3,566,135

Click here to switch to the map view.

The map label for this gene is aor [H]

Identifier: 51894417

GI number: 51894417

Start: 3507282

End: 3509096

Strand: Reverse

Name: aor [H]

Synonym: STH3283

Alternate gene names: 51894417

Gene position: 3509096-3507282 (Counterclockwise)

Preceding gene: 51894418

Following gene: 51894416

Centisome position: 98.4

GC content: 67.88

Gene sequence:

>1815_bases
ATGACGCTCACGGGCTACGCGAACCGCGTCGCGCGCATCGACCTGACGACAGGGCGCATCGACTACGAACCGATCGACCC
GGAGGCGGCGCGCAAGTACATCGGCGGCCGGGGACTCGGTGTGAAGTACGTGTTCGACAACGGGCCGGAGGTCGATCCCC
TGTCGCCGGAGAACCTGCTCTGCTTCATGAACGGTCCGCTCACGGGCAGCGCCATCAATATGTCCGGCCGTCTGGCGGTC
TGCACGAAGTCGCCGCTCACCGGCGGGGTGACCGACTCCCACATGGGCGGCTGGTCCGCGGCCAGACTCCGCTGGTCAGG
GTTTGACGGGCTGCTGTTCCGCGGGGCCGCGCCGACGCCCGTCTACGCGATCTGTGAGAACGGGACCGTACGGCTGGCGG
ATGCCTCGGACCTCTGGGGCAAGGGCATCCGGGAGACGGTGCGGATCCTGCAGGAGCGGCACGGCGGCAGGAACGTCTCA
GTCATGGCCATTGGCCCGGCCGGCGAGAATCTGGTGCGTTACGCCTCGATCCTGAACGAGAACGACCGCGCGGCCGGTCG
TGGCGGCACCGGCGCCGTGATGGGCGCCAAGAAGCTGAAGGCGGTCGTGGCCATCGGCGACATCAAGGACCAGTGGAAGC
CCGCGGATGACCGCCGGAATACCTTCGAGGATGCCCGCAAGGCCGGCCTGAAGGCGATCATGGAGGGGGCGCTGACCGCG
CCGCGCAAGGGCGGCCTGTCGCTCTACGGCACGAACGTGCTGATGAACATCATCAACGAGGTCGGGGCCCTGCCGGCCTT
CAACGGCAAGGAGACCTTCCACCCGGATGCCGAGGCCATCTCGGGGGAGACCATCCGGGCGCAGTACCTGGTGGAGGAGC
CCACCTGCCACGCCTGCCCCGTGGCCTGCAAGAAGCTGGTGGAAATCAAGGAAGGCCCCTACGCGGGGGTCCGCACCGAG
TCCTTCGAGTACGAGACGGCGTGGGCGCTGGGCGTCAACTGCGGCCTGACCGACGCCGGGGCGGTGGCGAAGCTGCTGGA
TCTGTGCAACGACTACGGCATGGACACGATTGAGCTGGGCAATGTGCTTTCCACCACCATGGAGGCCACCGAGCTGGGAC
TGGTGAAGGACGGCATCGCCTGGGGCGACGCCGCACGGATGATTGAGGTGGCGGGTCTCATCGCGCGCGCGGAGGGGGAT
CTGGGCAAGACCCTGGGTCTGGGCGCGTACGGTGCGGCGAAGGCCTTCGGCCGGCCGGATCTGGCCAACTCGGTGAAGGG
GCAGGCCATTCCGGCTTACGACCCGCGCGGCATCAAGGGGATCGGGCTGGGGTACGCGACCTCCAACCGGGGCGCCTGCC
ACCTGCGCGGCTACACGGTGGCGTCGGAGATCGCGGGGATCCCCGAACAGACCGACCGGCTGGCCACGGAGGGCAAGGGC
GCGCTGTTGAAGGTCTTCCAGGACCTGCACGCTTTCTCCGACTCCCTCGACCTGTGCAAGTTCTCGGCCTTCGCAATGGG
CGCGGAGGAGTACGCGCAGGCCTACAGCGCGGTCACCGGCGTGCCGTTTACGGCGGAGGACGTCATGCGCACCGGCGAGC
GCATCTACAACCTGGAGCGGTATTACAACAACCTGGCCGGGCTGGGGGAGGGCAGCGATTACCTTCCGAAGCGCTTCCTC
ACGGAGCCTGCGACCGGCGGCAGCGCCGGCCAGGTGTCGGAGCTGGACGTGATGCTCCAGGAGTACTACGCGGCGCGCGG
CTGGCAGAACGGCGTGGTGCCGGTAGAAAAACTCCGGGAACTGGAGATCATCTGA

Upstream 100 bases:

>100_bases
GGCGAGCCTCCCCCCTTCACGTGCATCCTGTCACAAAGAAGGAATTCGCAGCATTTGTCGAATATTATTGCAGAAATGCG
ACTGAGAGGGGTGGCTCAGC

Downstream 100 bases:

>100_bases
GCCGTGCAGGTTCGTCTCTACGCGACGCTGCGTGCCCTGGCCGGCGCCGCACGGGTCGAGGTCCCGGGCACGCCCGGTGA
GCCGGTGGGAGATGTGCTTC

Product: aldehyde ferredoxin oxidoreductase

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 604; Mature: 603

Protein sequence:

>604_residues
MTLTGYANRVARIDLTTGRIDYEPIDPEAARKYIGGRGLGVKYVFDNGPEVDPLSPENLLCFMNGPLTGSAINMSGRLAV
CTKSPLTGGVTDSHMGGWSAARLRWSGFDGLLFRGAAPTPVYAICENGTVRLADASDLWGKGIRETVRILQERHGGRNVS
VMAIGPAGENLVRYASILNENDRAAGRGGTGAVMGAKKLKAVVAIGDIKDQWKPADDRRNTFEDARKAGLKAIMEGALTA
PRKGGLSLYGTNVLMNIINEVGALPAFNGKETFHPDAEAISGETIRAQYLVEEPTCHACPVACKKLVEIKEGPYAGVRTE
SFEYETAWALGVNCGLTDAGAVAKLLDLCNDYGMDTIELGNVLSTTMEATELGLVKDGIAWGDAARMIEVAGLIARAEGD
LGKTLGLGAYGAAKAFGRPDLANSVKGQAIPAYDPRGIKGIGLGYATSNRGACHLRGYTVASEIAGIPEQTDRLATEGKG
ALLKVFQDLHAFSDSLDLCKFSAFAMGAEEYAQAYSAVTGVPFTAEDVMRTGERIYNLERYYNNLAGLGEGSDYLPKRFL
TEPATGGSAGQVSELDVMLQEYYAARGWQNGVVPVEKLRELEII

Sequences:

>Translated_604_residues
MTLTGYANRVARIDLTTGRIDYEPIDPEAARKYIGGRGLGVKYVFDNGPEVDPLSPENLLCFMNGPLTGSAINMSGRLAV
CTKSPLTGGVTDSHMGGWSAARLRWSGFDGLLFRGAAPTPVYAICENGTVRLADASDLWGKGIRETVRILQERHGGRNVS
VMAIGPAGENLVRYASILNENDRAAGRGGTGAVMGAKKLKAVVAIGDIKDQWKPADDRRNTFEDARKAGLKAIMEGALTA
PRKGGLSLYGTNVLMNIINEVGALPAFNGKETFHPDAEAISGETIRAQYLVEEPTCHACPVACKKLVEIKEGPYAGVRTE
SFEYETAWALGVNCGLTDAGAVAKLLDLCNDYGMDTIELGNVLSTTMEATELGLVKDGIAWGDAARMIEVAGLIARAEGD
LGKTLGLGAYGAAKAFGRPDLANSVKGQAIPAYDPRGIKGIGLGYATSNRGACHLRGYTVASEIAGIPEQTDRLATEGKG
ALLKVFQDLHAFSDSLDLCKFSAFAMGAEEYAQAYSAVTGVPFTAEDVMRTGERIYNLERYYNNLAGLGEGSDYLPKRFL
TEPATGGSAGQVSELDVMLQEYYAARGWQNGVVPVEKLRELEII
>Mature_603_residues
TLTGYANRVARIDLTTGRIDYEPIDPEAARKYIGGRGLGVKYVFDNGPEVDPLSPENLLCFMNGPLTGSAINMSGRLAVC
TKSPLTGGVTDSHMGGWSAARLRWSGFDGLLFRGAAPTPVYAICENGTVRLADASDLWGKGIRETVRILQERHGGRNVSV
MAIGPAGENLVRYASILNENDRAAGRGGTGAVMGAKKLKAVVAIGDIKDQWKPADDRRNTFEDARKAGLKAIMEGALTAP
RKGGLSLYGTNVLMNIINEVGALPAFNGKETFHPDAEAISGETIRAQYLVEEPTCHACPVACKKLVEIKEGPYAGVRTES
FEYETAWALGVNCGLTDAGAVAKLLDLCNDYGMDTIELGNVLSTTMEATELGLVKDGIAWGDAARMIEVAGLIARAEGDL
GKTLGLGAYGAAKAFGRPDLANSVKGQAIPAYDPRGIKGIGLGYATSNRGACHLRGYTVASEIAGIPEQTDRLATEGKGA
LLKVFQDLHAFSDSLDLCKFSAFAMGAEEYAQAYSAVTGVPFTAEDVMRTGERIYNLERYYNNLAGLGEGSDYLPKRFLT
EPATGGSAGQVSELDVMLQEYYAARGWQNGVVPVEKLRELEII

Specific function: Catalyzes the oxidation of aldehydes to their corresponding carboxylic acids. May have a pyroglycolytic (saccharolytic) role [H]

COG id: COG2414

COG function: function code C; Aldehyde:ferredoxin oxidoreductase

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the AOR/FOR family [H]

Homologues:

Organism=Escherichia coli, GI1787962, Length=205, Percent_Identity=39.0243902439024, Blast_Score=133, Evalue=3e-32,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR013985
- InterPro:   IPR013983
- InterPro:   IPR001203 [H]

Pfam domain/function: PF01314 AFOR_C; PF02730 AFOR_N [H]

EC number: =1.2.7.5 [H]

Molecular weight: Translated: 64348; Mature: 64217

Theoretical pI: Translated: 5.14; Mature: 5.14

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.7 %Cys     (Translated Protein)
2.3 %Met     (Translated Protein)
4.0 %Cys+Met (Translated Protein)
1.7 %Cys     (Mature Protein)
2.2 %Met     (Mature Protein)
3.8 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MTLTGYANRVARIDLTTGRIDYEPIDPEAARKYIGGRGLGVKYVFDNGPEVDPLSPENLL
CCCCCCCCCEEEEEEEECEEECCCCCHHHHHHHHCCCCCEEEEEECCCCCCCCCCCCCEE
CFMNGPLTGSAINMSGRLAVCTKSPLTGGVTDSHMGGWSAARLRWSGFDGLLFRGAAPTP
EEECCCCCCCEECCCCCEEEEECCCCCCCCCCCCCCCCHHHEEEECCCCCEEECCCCCCC
VYAICENGTVRLADASDLWGKGIRETVRILQERHGGRNVSVMAIGPAGENLVRYASILNE
EEEEECCCEEEEECCHHHHHCCHHHHHHHHHHHCCCCEEEEEEECCCCHHHHHHHHHHCC
NDRAAGRGGTGAVMGAKKLKAVVAIGDIKDQWKPADDRRNTFEDARKAGLKAIMEGALTA
CCCCCCCCCCCHHHHHHHHEEEEEECCCHHCCCCCCHHHHHHHHHHHHHHHHHHHHHCCC
PRKGGLSLYGTNVLMNIINEVGALPAFNGKETFHPDAEAISGETIRAQYLVEEPTCHACP
CCCCCEEEEHHHHHHHHHHHHCCCCCCCCCCCCCCCHHHCCCCEEEEEEEECCCCCCCCH
VACKKLVEIKEGPYAGVRTESFEYETAWALGVNCGLTDAGAVAKLLDLCNDYGMDTIELG
HHHHHHHHHCCCCCCCCCCCCCCCCEEEEEECCCCCCCHHHHHHHHHHHHHCCCCHHHHH
NVLSTTMEATELGLVKDGIAWGDAARMIEVAGLIARAEGDLGKTLGLGAYGAAKAFGRPD
HHHHHHHHHHHHCHHHCCCCCCHHHHHHHHHHHHHHCCCCCCCHHCCCCCHHHHHCCCCC
LANSVKGQAIPAYDPRGIKGIGLGYATSNRGACHLRGYTVASEIAGIPEQTDRLATEGKG
HHHCCCCCCCCCCCCCCCCEEEEEEECCCCCEEEEECCCHHHHHCCCCHHHHHHHHCCCH
ALLKVFQDLHAFSDSLDLCKFSAFAMGAEEYAQAYSAVTGVPFTAEDVMRTGERIYNLER
HHHHHHHHHHHHHCCHHHHHHHHHHCCHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHH
YYNNLAGLGEGSDYLPKRFLTEPATGGSAGQVSELDVMLQEYYAARGWQNGVVPVEKLRE
HHHHHCCCCCCCCCCCHHHHCCCCCCCCCCCHHHHHHHHHHHHHHCCCCCCCCCHHHHHH
LEII
CCCC
>Mature Secondary Structure 
TLTGYANRVARIDLTTGRIDYEPIDPEAARKYIGGRGLGVKYVFDNGPEVDPLSPENLL
CCCCCCCCEEEEEEEECEEECCCCCHHHHHHHHCCCCCEEEEEECCCCCCCCCCCCCEE
CFMNGPLTGSAINMSGRLAVCTKSPLTGGVTDSHMGGWSAARLRWSGFDGLLFRGAAPTP
EEECCCCCCCEECCCCCEEEEECCCCCCCCCCCCCCCCHHHEEEECCCCCEEECCCCCCC
VYAICENGTVRLADASDLWGKGIRETVRILQERHGGRNVSVMAIGPAGENLVRYASILNE
EEEEECCCEEEEECCHHHHHCCHHHHHHHHHHHCCCCEEEEEEECCCCHHHHHHHHHHCC
NDRAAGRGGTGAVMGAKKLKAVVAIGDIKDQWKPADDRRNTFEDARKAGLKAIMEGALTA
CCCCCCCCCCCHHHHHHHHEEEEEECCCHHCCCCCCHHHHHHHHHHHHHHHHHHHHHCCC
PRKGGLSLYGTNVLMNIINEVGALPAFNGKETFHPDAEAISGETIRAQYLVEEPTCHACP
CCCCCEEEEHHHHHHHHHHHHCCCCCCCCCCCCCCCHHHCCCCEEEEEEEECCCCCCCCH
VACKKLVEIKEGPYAGVRTESFEYETAWALGVNCGLTDAGAVAKLLDLCNDYGMDTIELG
HHHHHHHHHCCCCCCCCCCCCCCCCEEEEEECCCCCCCHHHHHHHHHHHHHCCCCHHHHH
NVLSTTMEATELGLVKDGIAWGDAARMIEVAGLIARAEGDLGKTLGLGAYGAAKAFGRPD
HHHHHHHHHHHHCHHHCCCCCCHHHHHHHHHHHHHHCCCCCCCHHCCCCCHHHHHCCCCC
LANSVKGQAIPAYDPRGIKGIGLGYATSNRGACHLRGYTVASEIAGIPEQTDRLATEGKG
HHHCCCCCCCCCCCCCCCCEEEEEEECCCCCEEEEECCCHHHHHCCCCHHHHHHHHCCCH
ALLKVFQDLHAFSDSLDLCKFSAFAMGAEEYAQAYSAVTGVPFTAEDVMRTGERIYNLER
HHHHHHHHHHHHHCCHHHHHHHHHHCCHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHH
YYNNLAGLGEGSDYLPKRFLTEPATGGSAGQVSELDVMLQEYYAARGWQNGVVPVEKLRE
HHHHHCCCCCCCCCCCHHHHCCCCCCCCCCCHHHHHHHHHHHHHHCCCCCCCCCHHHHHH
LEII
CCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 7642512; 7878465 [H]