Definition Methanopyrus kandleri AV19, complete genome.
Accession NC_003551
Length 1,694,969

Click here to switch to the map view.

The map label for this gene is ThiH_1

Identifier: 20094333

GI number: 20094333

Start: 846128

End: 847237

Strand: Reverse

Name: ThiH_1

Synonym: MK0897

Alternate gene names: 20094333

Gene position: 847237-846128 (Counterclockwise)

Preceding gene: 161485663

Following gene: 20094332

Centisome position: 49.99

GC content: 59.28

Gene sequence:

>1110_bases
ATGAGGGATTCGCCCGATGAAGTCAGCGTCGACGAGCTGGTGAACATGGCCGTGGCCGGTGGCATCGACGAAGGAACGGC
GTTGGACGCCTTACAGGGTAAGCTGGACCCGTACAAGGTAATGCGGGCTGCACACGAGGCCCGACTTAAGATCGTCGGTG
AACACGTCACGTTCGTGGTGAACAGGAACATCAACTTCACCAACGTGTGCATTAACAGATGTCGATTCTGTGCGTTCCGG
AGGGATCCGGACGACCCGGATGCTTACCGTATGACGCCGGAGGAGGTGGGCGAGCGGGCAGCGGAAGCCCGTGACGCTGG
AGCTACGGAAGTATGTCTTCAGGGCGGACTGCATCCCGAGGCGACGTTTGAGTACTACCTGGAAATGTTGGACGAGATCA
AGTCCCAAGCCCCGGACATCCACGTGCACGGGTACTCACCGATGGAGGTGAAGTACTGCGCCAAGCTGGCGGGAGAGGAC
ATCGAAGACGTACTACGAGAGCTGAAGCGAGCCGGTCTCGATTCGATGCCCGGAACGGCCGCGGAGATATTCTCCCCTGA
GGTGAGGAAGCGGCTATGTCCTGATAAGTTGGAAGCCGATGAGTGGGAACATATCATCAGGATCGCGCACGAGTTGGGAA
TTCCCACCACTTGTACTATGATGTACGGTCACATCGACTCACCGAGGGACTGGATCGACCACATGAAGCGGCTTCGAGGG
ATCCAAGAGGACACGGGAGGCTTCACGGAGTTCGTGCCGCTCTCCTTCGTACATTCGAACGCACCGATTTACCGACGAGG
AGGGGCGCGACCCGGAGTATCGGGTATGACGGACGTACTCGTGCACGCTGTGGCCCGATTGTACTTCGGACCGTTGATTC
CGAACATACAGGCTTCCTGGGTGAAGCTCGGAGTGAAGCTGGCTCAGATGACGCTGCACGCCGGGGCGAACGATCTAGGT
GGCACCCTCATGGAAGAGAACATCTCCCGGGAGGCCGGAGCGACCGAGGGCGAGCAGCTCGAGCCCGAGGAGATAGTGGA
GATCATTCGGGAGGCGGGCTTCACCCCCGTGCAGCGCACCACGCTCTACGAGCCGGTGAAGGTGTACTAA

Upstream 100 bases:

>100_bases
GGTTTCAGGTTAAGGGAGCGGCTCCCTATTTACCCCGAGTACGTCCGTCGGGGCTGGTACCATGCCAACATCTCAGAAGT
CGTCGAGCGGCTCTCGGACG

Downstream 100 bases:

>100_bases
GGTAGGGGGCGCTTCGCATGACCAGGGTCGGTGAGTTCATCCGTGTGCTGAACCGGGTGCTGGACTCGGAGCTGGCACGG
CGGCTGATGAAGCTGGGGGC

Product: thiamine biosynthesis protein ThiH-like protein

Products: NA

Alternate protein names: 7,8-didemethyl-8-hydroxy-5-deazariboflavin synthase subunit 2

Number of amino acids: Translated: 369; Mature: 369

Protein sequence:

>369_residues
MRDSPDEVSVDELVNMAVAGGIDEGTALDALQGKLDPYKVMRAAHEARLKIVGEHVTFVVNRNINFTNVCINRCRFCAFR
RDPDDPDAYRMTPEEVGERAAEARDAGATEVCLQGGLHPEATFEYYLEMLDEIKSQAPDIHVHGYSPMEVKYCAKLAGED
IEDVLRELKRAGLDSMPGTAAEIFSPEVRKRLCPDKLEADEWEHIIRIAHELGIPTTCTMMYGHIDSPRDWIDHMKRLRG
IQEDTGGFTEFVPLSFVHSNAPIYRRGGARPGVSGMTDVLVHAVARLYFGPLIPNIQASWVKLGVKLAQMTLHAGANDLG
GTLMEENISREAGATEGEQLEPEEIVEIIREAGFTPVQRTTLYEPVKVY

Sequences:

>Translated_369_residues
MRDSPDEVSVDELVNMAVAGGIDEGTALDALQGKLDPYKVMRAAHEARLKIVGEHVTFVVNRNINFTNVCINRCRFCAFR
RDPDDPDAYRMTPEEVGERAAEARDAGATEVCLQGGLHPEATFEYYLEMLDEIKSQAPDIHVHGYSPMEVKYCAKLAGED
IEDVLRELKRAGLDSMPGTAAEIFSPEVRKRLCPDKLEADEWEHIIRIAHELGIPTTCTMMYGHIDSPRDWIDHMKRLRG
IQEDTGGFTEFVPLSFVHSNAPIYRRGGARPGVSGMTDVLVHAVARLYFGPLIPNIQASWVKLGVKLAQMTLHAGANDLG
GTLMEENISREAGATEGEQLEPEEIVEIIREAGFTPVQRTTLYEPVKVY
>Mature_369_residues
MRDSPDEVSVDELVNMAVAGGIDEGTALDALQGKLDPYKVMRAAHEARLKIVGEHVTFVVNRNINFTNVCINRCRFCAFR
RDPDDPDAYRMTPEEVGERAAEARDAGATEVCLQGGLHPEATFEYYLEMLDEIKSQAPDIHVHGYSPMEVKYCAKLAGED
IEDVLRELKRAGLDSMPGTAAEIFSPEVRKRLCPDKLEADEWEHIIRIAHELGIPTTCTMMYGHIDSPRDWIDHMKRLRG
IQEDTGGFTEFVPLSFVHSNAPIYRRGGARPGVSGMTDVLVHAVARLYFGPLIPNIQASWVKLGVKLAQMTLHAGANDLG
GTLMEENISREAGATEGEQLEPEEIVEIIREAGFTPVQRTTLYEPVKVY

Specific function: Catalyzes the radical-mediated transfer of the hydroxybenzyl group from 4-hydroxyphenylpyruvate (HPP) to 5-amino- 6-ribitylamino-2,4(1H,3H)-pyrimidinedione to form 7,8-didemethyl- 8-hydroxy-5-deazariboflavin (FO)

COG id: COG1060

COG function: function code HR; Thiamine biosynthesis enzyme ThiH and related uncharacterized enzymes

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Belongs to the radical SAM superfamily. CofH family

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): COFH_METKA (Q8TWY4)

Other databases:

- EMBL:   AE009439
- RefSeq:   NP_614180.1
- ProteinModelPortal:   Q8TWY4
- GeneID:   1476998
- GenomeReviews:   AE009439_GR
- KEGG:   mka:MK0897
- NMPDR:   fig|190192.1.peg.893
- HOGENOM:   HBG312134
- OMA:   TMMYGHI
- BioCyc:   MKAN190192:MK0897-MONOMER
- HAMAP:   MF_01612
- InterPro:   IPR013785
- InterPro:   IPR019940
- InterPro:   IPR006638
- InterPro:   IPR020050
- InterPro:   IPR005244
- InterPro:   IPR007197
- Gene3D:   G3DSA:3.20.20.70
- PIRSF:   PIRSF004762
- SMART:   SM00729
- TIGRFAMs:   TIGR00423
- TIGRFAMs:   TIGR03551

Pfam domain/function: PF04055 Radical_SAM

EC number: NA

Molecular weight: Translated: 41064; Mature: 41064

Theoretical pI: Translated: 4.73; Mature: 4.73

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.9 %Cys     (Translated Protein)
3.5 %Met     (Translated Protein)
5.4 %Cys+Met (Translated Protein)
1.9 %Cys     (Mature Protein)
3.5 %Met     (Mature Protein)
5.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MRDSPDEVSVDELVNMAVAGGIDEGTALDALQGKLDPYKVMRAAHEARLKIVGEHVTFVV
CCCCCCCCCHHHHHHHHHHCCCCCCHHHHHHHCCCCHHHHHHHHHHHHHHHEECEEEEEE
NRNINFTNVCINRCRFCAFRRDPDDPDAYRMTPEEVGERAAEARDAGATEVCLQGGLHPE
ECCCCHHHHHHHHHHHHHHCCCCCCCCCCCCCHHHHHHHHHHHHCCCHHHHHHHCCCCCH
ATFEYYLEMLDEIKSQAPDIHVHGYSPMEVKYCAKLAGEDIEDVLRELKRAGLDSMPGTA
HHHHHHHHHHHHHHHHCCCEEEECCCCHHHHHHHHHCCCCHHHHHHHHHHCCCCCCCCCH
AEIFSPEVRKRLCPDKLEADEWEHIIRIAHELGIPTTCTMMYGHIDSPRDWIDHMKRLRG
HHHCCHHHHHHCCCCCCCHHHHHHHHHHHHHHCCCCEEHHHHCCCCCHHHHHHHHHHHCC
IQEDTGGFTEFVPLSFVHSNAPIYRRGGARPGVSGMTDVLVHAVARLYFGPLIPNIQASW
CCHHCCCCHHHHHHHHHCCCCCEEECCCCCCCCCHHHHHHHHHHHHHHHHHCCCCCHHHH
VKLGVKLAQMTLHAGANDLGGTLMEENISREAGATEGEQLEPEEIVEIIREAGFTPVQRT
HHHHHHHHHHHHHCCCCHHCCHHHHHHHHHHCCCCCCCCCCHHHHHHHHHHCCCCCCHHH
TLYEPVKVY
HCCCCCCCC
>Mature Secondary Structure
MRDSPDEVSVDELVNMAVAGGIDEGTALDALQGKLDPYKVMRAAHEARLKIVGEHVTFVV
CCCCCCCCCHHHHHHHHHHCCCCCCHHHHHHHCCCCHHHHHHHHHHHHHHHEECEEEEEE
NRNINFTNVCINRCRFCAFRRDPDDPDAYRMTPEEVGERAAEARDAGATEVCLQGGLHPE
ECCCCHHHHHHHHHHHHHHCCCCCCCCCCCCCHHHHHHHHHHHHCCCHHHHHHHCCCCCH
ATFEYYLEMLDEIKSQAPDIHVHGYSPMEVKYCAKLAGEDIEDVLRELKRAGLDSMPGTA
HHHHHHHHHHHHHHHHCCCEEEECCCCHHHHHHHHHCCCCHHHHHHHHHHCCCCCCCCCH
AEIFSPEVRKRLCPDKLEADEWEHIIRIAHELGIPTTCTMMYGHIDSPRDWIDHMKRLRG
HHHCCHHHHHHCCCCCCCHHHHHHHHHHHHHHCCCCEEHHHHCCCCCHHHHHHHHHHHCC
IQEDTGGFTEFVPLSFVHSNAPIYRRGGARPGVSGMTDVLVHAVARLYFGPLIPNIQASW
CCHHCCCCHHHHHHHHHCCCCCEEECCCCCCCCCHHHHHHHHHHHHHHHHHCCCCCHHHH
VKLGVKLAQMTLHAGANDLGGTLMEENISREAGATEGEQLEPEEIVEIIREAGFTPVQRT
HHHHHHHHHHHHHCCCCHHCCHHHHHHHHHHCCCCCCCCCCHHHHHHHHHHCCCCCCHHH
TLYEPVKVY
HCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 11930014