The gene/protein map for NC_003106 is currently unavailable.
Definition Sulfolobus tokodaii str. 7 chromosome, complete genome.
Accession NC_003106
Length 2,694,756

Click here to switch to the map view.

The map label for this gene is yqkF [H]

Identifier: 15920568

GI number: 15920568

Start: 382486

End: 383475

Strand: Reverse

Name: yqkF [H]

Synonym: ST0366

Alternate gene names: 15920568

Gene position: 383475-382486 (Counterclockwise)

Preceding gene: 15920570

Following gene: 15920561

Centisome position: 14.23

GC content: 28.89

Gene sequence:

>990_bases
GTGTGGTATTACATGAATCTAAGAAAAATAGATCATACTAATATTGAAGTATCAGAGATAGGAATTGGTGTTTGGAGTCT
TGTTACTGATTGGTGGGGAGGAGAAATTAACAAAGCTGAAGAGATATTGAAGAAAGCGCTAGAAAACGGAATAAACTTCT
TTGATACTGCAGATGTATATGGTGAAGGACTTGGTGAAAAAATATTAGCCAAAGTCTTTAACACAAAAAGAGATAAAATA
ATCATTCTAACAAAAATAGGCTATGACTTCTATAATAAATCAAATAACAGAATTTCACAGAGATTTTCGATAGAATATAT
AGATTATGCATTCAAGAAAAGTCTAGAGAGACTTAATACAGATTACATTGATATCTTAATGATACATAATCCTAAGATGC
ATATAATAAAAAATAAAGAAATATTAGATTTTTTACAGGGTTTAAAAAAAGAAGGAAAAGTTAGATTAATTGGAGTAGCA
TTAGGACCAACATTAGGATGGGGAGAGGAAGGCATAGAAGCTATAAAAATGGGATATGAAAGCCTGGAATATATATATAA
TTTAATCGAATTAAAGCCTGGAATAGATTTCTTAAATTATGATATTGGTCATTTCGTTAGAGTACCTCATGCATCCGATG
CACTAATTGAAGATAAATGGCCAATATATAATGATCCTAAACTACATAGGAGCTTAAAAGATATTAATTGGATTAGAAGA
GCAGTTGAACTTTCTAAACCTCTTCTTTCCTTTGCTAGAAATAAAGGAATGAAATTATCTCAACTAGCTTTAAAATTTAT
ACTATATAACAAAAGAGTCTCTTCAGTTCTTCCTAATATATCATCTATTAACGAACTTAATGAATTCCTTGAAGTAGAAA
AATTGCCAGAATTAACAGAAGAAGAGTATAAATATCTATATGAATATTCTATAAACAATTTTAGTGAATTGAATAAGGAG
AGCATTGAAGAAACTAAGAGATATAAGTAA

Upstream 100 bases:

>100_bases
TTTTCAATTTTCTGAGTAGTTCATCAAATACTCTTTCTGGCACTTTTACAAGCATTATACATTATGCTTTTTATAACATC
AAAAATGATTTTAACATTAG

Downstream 100 bases:

>100_bases
GAAAGAATTTTATAAACTCTTCAAAGGCTTTACCTCTATGTGAATACTTATTTTTCTCTTCAATATTCATTTCACCAAAA
GTTCTTTCATCTCCATCTGG

Product: oxidoreductase

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 329; Mature: 329

Protein sequence:

>329_residues
MWYYMNLRKIDHTNIEVSEIGIGVWSLVTDWWGGEINKAEEILKKALENGINFFDTADVYGEGLGEKILAKVFNTKRDKI
IILTKIGYDFYNKSNNRISQRFSIEYIDYAFKKSLERLNTDYIDILMIHNPKMHIIKNKEILDFLQGLKKEGKVRLIGVA
LGPTLGWGEEGIEAIKMGYESLEYIYNLIELKPGIDFLNYDIGHFVRVPHASDALIEDKWPIYNDPKLHRSLKDINWIRR
AVELSKPLLSFARNKGMKLSQLALKFILYNKRVSSVLPNISSINELNEFLEVEKLPELTEEEYKYLYEYSINNFSELNKE
SIEETKRYK

Sequences:

>Translated_329_residues
MWYYMNLRKIDHTNIEVSEIGIGVWSLVTDWWGGEINKAEEILKKALENGINFFDTADVYGEGLGEKILAKVFNTKRDKI
IILTKIGYDFYNKSNNRISQRFSIEYIDYAFKKSLERLNTDYIDILMIHNPKMHIIKNKEILDFLQGLKKEGKVRLIGVA
LGPTLGWGEEGIEAIKMGYESLEYIYNLIELKPGIDFLNYDIGHFVRVPHASDALIEDKWPIYNDPKLHRSLKDINWIRR
AVELSKPLLSFARNKGMKLSQLALKFILYNKRVSSVLPNISSINELNEFLEVEKLPELTEEEYKYLYEYSINNFSELNKE
SIEETKRYK
>Mature_329_residues
MWYYMNLRKIDHTNIEVSEIGIGVWSLVTDWWGGEINKAEEILKKALENGINFFDTADVYGEGLGEKILAKVFNTKRDKI
IILTKIGYDFYNKSNNRISQRFSIEYIDYAFKKSLERLNTDYIDILMIHNPKMHIIKNKEILDFLQGLKKEGKVRLIGVA
LGPTLGWGEEGIEAIKMGYESLEYIYNLIELKPGIDFLNYDIGHFVRVPHASDALIEDKWPIYNDPKLHRSLKDINWIRR
AVELSKPLLSFARNKGMKLSQLALKFILYNKRVSSVLPNISSINELNEFLEVEKLPELTEEEYKYLYEYSINNFSELNKE
SIEETKRYK

Specific function: Unknown

COG id: COG0667

COG function: function code C; Predicted oxidoreductases (related to aryl-alcohol dehydrogenases)

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the aldo/keto reductase 2 family [H]

Homologues:

Organism=Homo sapiens, GI4504825, Length=324, Percent_Identity=28.0864197530864, Blast_Score=89, Evalue=5e-18,
Organism=Homo sapiens, GI27436969, Length=322, Percent_Identity=27.639751552795, Blast_Score=89, Evalue=6e-18,
Organism=Homo sapiens, GI27436971, Length=332, Percent_Identity=27.4096385542169, Blast_Score=84, Evalue=2e-16,
Organism=Homo sapiens, GI27436962, Length=330, Percent_Identity=26.6666666666667, Blast_Score=81, Evalue=2e-15,
Organism=Homo sapiens, GI27436964, Length=330, Percent_Identity=26.6666666666667, Blast_Score=80, Evalue=2e-15,
Organism=Homo sapiens, GI27436966, Length=330, Percent_Identity=26.6666666666667, Blast_Score=80, Evalue=3e-15,
Organism=Escherichia coli, GI87081735, Length=163, Percent_Identity=30.0613496932515, Blast_Score=72, Evalue=4e-14,
Organism=Escherichia coli, GI1788070, Length=161, Percent_Identity=31.6770186335404, Blast_Score=69, Evalue=3e-13,
Organism=Saccharomyces cerevisiae, GI6325169, Length=335, Percent_Identity=27.4626865671642, Blast_Score=72, Evalue=1e-13,
Organism=Drosophila melanogaster, GI24646155, Length=166, Percent_Identity=31.9277108433735, Blast_Score=73, Evalue=2e-13,
Organism=Drosophila melanogaster, GI24646159, Length=163, Percent_Identity=30.0613496932515, Blast_Score=67, Evalue=1e-11,
Organism=Drosophila melanogaster, GI24640980, Length=127, Percent_Identity=36.2204724409449, Blast_Score=66, Evalue=4e-11,
Organism=Drosophila melanogaster, GI45549126, Length=127, Percent_Identity=36.2204724409449, Blast_Score=65, Evalue=5e-11,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR001395
- InterPro:   IPR020471
- InterPro:   IPR023210 [H]

Pfam domain/function: PF00248 Aldo_ket_red [H]

EC number: 1.-.-.- [C]

Molecular weight: Translated: 38526; Mature: 38526

Theoretical pI: Translated: 6.54; Mature: 6.54

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.0 %Cys     (Translated Protein)
1.8 %Met     (Translated Protein)
1.8 %Cys+Met (Translated Protein)
0.0 %Cys     (Mature Protein)
1.8 %Met     (Mature Protein)
1.8 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MWYYMNLRKIDHTNIEVSEIGIGVWSLVTDWWGGEINKAEEILKKALENGINFFDTADVY
CEEEEEEEECCCCCEEHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHCCCCCCCCHHHH
GEGLGEKILAKVFNTKRDKIIILTKIGYDFYNKSNNRISQRFSIEYIDYAFKKSLERLNT
HCCHHHHHHHHHHCCCCCEEEEEEECCCHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHCC
DYIDILMIHNPKMHIIKNKEILDFLQGLKKEGKVRLIGVALGPTLGWGEEGIEAIKMGYE
CEEEEEEEECCCEEEECCHHHHHHHHHHHCCCCEEEEEEEECCCCCCCHHHHHHHHHHHH
SLEYIYNLIELKPGIDFLNYDIGHFVRVPHASDALIEDKWPIYNDPKLHRSLKDINWIRR
HHHHHHHHHHHCCCCCHHHCCHHHEEECCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHH
AVELSKPLLSFARNKGMKLSQLALKFILYNKRVSSVLPNISSINELNEFLEVEKLPELTE
HHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHCCCHHH
EEYKYLYEYSINNFSELNKESIEETKRYK
HHHHHHHHHCCCCHHHCCHHHHHHHHCCC
>Mature Secondary Structure
MWYYMNLRKIDHTNIEVSEIGIGVWSLVTDWWGGEINKAEEILKKALENGINFFDTADVY
CEEEEEEEECCCCCEEHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHCCCCCCCCHHHH
GEGLGEKILAKVFNTKRDKIIILTKIGYDFYNKSNNRISQRFSIEYIDYAFKKSLERLNT
HCCHHHHHHHHHHCCCCCEEEEEEECCCHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHCC
DYIDILMIHNPKMHIIKNKEILDFLQGLKKEGKVRLIGVALGPTLGWGEEGIEAIKMGYE
CEEEEEEEECCCEEEECCHHHHHHHHHHHCCCCEEEEEEEECCCCCCCHHHHHHHHHHHH
SLEYIYNLIELKPGIDFLNYDIGHFVRVPHASDALIEDKWPIYNDPKLHRSLKDINWIRR
HHHHHHHHHHHCCCCCHHHCCHHHEEECCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHH
AVELSKPLLSFARNKGMKLSQLALKFILYNKRVSSVLPNISSINELNEFLEVEKLPELTE
HHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHCCCHHH
EEYKYLYEYSINNFSELNKESIEETKRYK
HHHHHHHHHCCCCHHHCCHHHHHHHHCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: 8969508; 9384377 [H]