Definition Gloeobacter violaceus PCC 7421 chromosome, complete genome.
Accession NC_005125
Length 4,659,019

Click here to switch to the map view.

The map label for this gene is ubiB [C]

Identifier: 37522693

GI number: 37522693

Start: 3325991

End: 3327841

Strand: Direct

Name: ubiB [C]

Synonym: glr3124

Alternate gene names: 37522693

Gene position: 3325991-3327841 (Clockwise)

Preceding gene: 37522690

Following gene: 37522694

Centisome position: 71.39

GC content: 63.26

Gene sequence:

>1851_bases
ATGCGAGCCCTTAACGAGTCAACCGTCGAACCGCGCTTCGAGAGCGCCGCGCTGACCCGCCCGGGGGCCGGCCTCCCCAG
CGCTGCCGCCCCCGACTTGCCCTTCAAGTCCTACGACCCGGACCTGATTGCCCGCTATGCCGAGCGGCGCTTCGGCCGGG
TGTTGTGGCGCTTTTTTCAGACATTGCTGCCTTTTGTCGGTTTTGCGCTGCAGGTGCAGTGGGATCGCCTCACCGGTACG
GTCGCCCGCCATCAGCTAAAGCGGGCGGTGCGCCTGCGCGAGATCCTCACCCGCCTGGGGCCGACCTATATCAAGATTGG
TCAGGCGCTTTCGACCCGGCCCGATCTGGTGCCGCCGGTCTACCTTGACGAGTTGACGCTGTTGCAGGACCGCCTGCCGC
CGGTGCCCAACGCAGAAGCCTACGCGCTCATCCGCGCCGGGCTCGGGCGCGATCCCCACGAAATCTACGCCGAATTCGAC
GAGGTGCCCATCGCCGCCGCTTCCTTGGGTCAGGTCTACCGCGCCAGGCTCACCACCGGCGAGCGGGTAGCCGTCAAGGT
ACAGCGCCCCAATTTGATTCCGCTGGTGAGCCTGGATCTTTATTTGCAGCGGGGATTGCTCGGCTGGGTCGAGCGCAACG
TCCCTCAGGTCAAAAGCGATCTGCAGGCCATCCTCGACGAATTCGGCCGCAAGCTCTTCGAGGAGATGGACTACGTCCAG
GAGGGCAAGAACGCCGAGCGCTTCGCCGCCTGTTTCACCGAGATGCCCGAAGTTTATGTGCCGCGCATCTACTGGGATTA
CACCTGCCGCCAAGTGCTGACCATGGAGTGGATCGACGGCCTCAAGCTCACTCGCCTGGAGGATATCCAGCGGGCGGGCC
TCAATGCCCGCAAGGTGATCGAAAACGGTGTGCAGTGCTCGCTGAGGCAGCTGCTGGAGCACGGCTTCTTCCACGCCGAT
CCCCACCCGGGCAATTTGCTGGTGATGGCCGACGGCAGGCTCGCCTATCTCGACTTCGGGATGATGAGCGAGGTGGAACC
CGCCCAGCGCTACGGCCTGATCGAGGCCATCGTCCACATGGTCAATCGCGACTTCGACGGGCTGGCGCGCGATTACGTCA
AACTCGGTTTTCTCAAACCCGATCAAGACCTGAAGCCCATCGTACCGGTGCTGGCGGTAGTTTTTGGCCAGGCTCTGGGC
TCTAGCGTCGGCAGCCTCAACATCAAGAGCATCACCGACAACATGTCCTCGATGATGTACGACCTGCCGTTTCGGGTGCC
CGCCTTTTTTGCGCTGATCATTCGTTCACTGGTGACCCTCGAAGGGATCGCCATCTCGGTGGACCCGGACTTCAAGGTGC
TCGAAGTCGCCTACCCCTACGTGGCCCGCCGCCTGCTCACCGACAACGCCCCCGAACTGCGCGCTTCGCTGAGCGAATTG
TTGTTCAAGGACGGCTCCTTTCGCTGGAACCGCCTCGAGAATCTTGTGCGCAACGCCAGAAGCGCCAGGGACTACGACAT
CAACCGTGCCCTCGACCAGGCGGCCGAATTTTTGCTCTCCGAGCGGGGCGCTTCGATCCGCGAGAAGCTCATCGACGAAC
TGACCTCCGCGAGCACCGTCAACCCCAACGTCCCGGGCGGCAAAGCGAGCGGTCTACAGAATCTCGAAAGGCTCTGGTCC
TTGCTGCGTGAGGATCCCAAGCTCGACTTGCGCAAATCGGTCTCGATTTTGGGCAAGCTCATCCTCAAGCCCGAGGGCCG
CGACTTGAGCCGCCGGGTTGCAGGCCGCCTCCTGGAGCGCGAACTGGCTCGCCTGCTGCGCCGCACGCTTCTGCCCGCAA
CGCTCGCCTGA

Upstream 100 bases:

>100_bases
TCTGTGCCTGCTCGCTCACATCGTCTCCCCGGCCGTCGCTCAACTGTATCTGTTCCCCAGGCAGTAGAGAAAGTCCCGCC
GAAATGTTAACCTTTATTAC

Downstream 100 bases:

>100_bases
CTTTGGCCGGGGCCTTACATCTCCACAGAATAGGGCAGATTTTCCAGCGATCTTTCCCTTACAATCTGGGGTATCCACAC
ACCACCAATTACCGAACCCA

Product: hypothetical protein

Products: 2-octaprenyl-6-hydroxyphenol [C]

Alternate protein names: NA

Number of amino acids: Translated: 616; Mature: 616

Protein sequence:

>616_residues
MRALNESTVEPRFESAALTRPGAGLPSAAAPDLPFKSYDPDLIARYAERRFGRVLWRFFQTLLPFVGFALQVQWDRLTGT
VARHQLKRAVRLREILTRLGPTYIKIGQALSTRPDLVPPVYLDELTLLQDRLPPVPNAEAYALIRAGLGRDPHEIYAEFD
EVPIAAASLGQVYRARLTTGERVAVKVQRPNLIPLVSLDLYLQRGLLGWVERNVPQVKSDLQAILDEFGRKLFEEMDYVQ
EGKNAERFAACFTEMPEVYVPRIYWDYTCRQVLTMEWIDGLKLTRLEDIQRAGLNARKVIENGVQCSLRQLLEHGFFHAD
PHPGNLLVMADGRLAYLDFGMMSEVEPAQRYGLIEAIVHMVNRDFDGLARDYVKLGFLKPDQDLKPIVPVLAVVFGQALG
SSVGSLNIKSITDNMSSMMYDLPFRVPAFFALIIRSLVTLEGIAISVDPDFKVLEVAYPYVARRLLTDNAPELRASLSEL
LFKDGSFRWNRLENLVRNARSARDYDINRALDQAAEFLLSERGASIREKLIDELTSASTVNPNVPGGKASGLQNLERLWS
LLREDPKLDLRKSVSILGKLILKPEGRDLSRRVAGRLLERELARLLRRTLLPATLA

Sequences:

>Translated_616_residues
MRALNESTVEPRFESAALTRPGAGLPSAAAPDLPFKSYDPDLIARYAERRFGRVLWRFFQTLLPFVGFALQVQWDRLTGT
VARHQLKRAVRLREILTRLGPTYIKIGQALSTRPDLVPPVYLDELTLLQDRLPPVPNAEAYALIRAGLGRDPHEIYAEFD
EVPIAAASLGQVYRARLTTGERVAVKVQRPNLIPLVSLDLYLQRGLLGWVERNVPQVKSDLQAILDEFGRKLFEEMDYVQ
EGKNAERFAACFTEMPEVYVPRIYWDYTCRQVLTMEWIDGLKLTRLEDIQRAGLNARKVIENGVQCSLRQLLEHGFFHAD
PHPGNLLVMADGRLAYLDFGMMSEVEPAQRYGLIEAIVHMVNRDFDGLARDYVKLGFLKPDQDLKPIVPVLAVVFGQALG
SSVGSLNIKSITDNMSSMMYDLPFRVPAFFALIIRSLVTLEGIAISVDPDFKVLEVAYPYVARRLLTDNAPELRASLSEL
LFKDGSFRWNRLENLVRNARSARDYDINRALDQAAEFLLSERGASIREKLIDELTSASTVNPNVPGGKASGLQNLERLWS
LLREDPKLDLRKSVSILGKLILKPEGRDLSRRVAGRLLERELARLLRRTLLPATLA
>Mature_616_residues
MRALNESTVEPRFESAALTRPGAGLPSAAAPDLPFKSYDPDLIARYAERRFGRVLWRFFQTLLPFVGFALQVQWDRLTGT
VARHQLKRAVRLREILTRLGPTYIKIGQALSTRPDLVPPVYLDELTLLQDRLPPVPNAEAYALIRAGLGRDPHEIYAEFD
EVPIAAASLGQVYRARLTTGERVAVKVQRPNLIPLVSLDLYLQRGLLGWVERNVPQVKSDLQAILDEFGRKLFEEMDYVQ
EGKNAERFAACFTEMPEVYVPRIYWDYTCRQVLTMEWIDGLKLTRLEDIQRAGLNARKVIENGVQCSLRQLLEHGFFHAD
PHPGNLLVMADGRLAYLDFGMMSEVEPAQRYGLIEAIVHMVNRDFDGLARDYVKLGFLKPDQDLKPIVPVLAVVFGQALG
SSVGSLNIKSITDNMSSMMYDLPFRVPAFFALIIRSLVTLEGIAISVDPDFKVLEVAYPYVARRLLTDNAPELRASLSEL
LFKDGSFRWNRLENLVRNARSARDYDINRALDQAAEFLLSERGASIREKLIDELTSASTVNPNVPGGKASGLQNLERLWS
LLREDPKLDLRKSVSILGKLILKPEGRDLSRRVAGRLLERELARLLRRTLLPATLA

Specific function: Required, Probably Indirectly, For The Hydroxylation Of 2-Octaprenylphenol To 2-Octaprenyl-6-Hydroxy-Phenol, The Fourth Step In Ubiquinone Biosynthesis. Specific For Aerobically Grown Log-Phase Cells. [C]

COG id: COG0661

COG function: function code R; Predicted unusual protein kinase

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the protein kinase superfamily. ADCK protein kinase family [H]

Homologues:

Organism=Homo sapiens, GI41393593, Length=359, Percent_Identity=32.5905292479109, Blast_Score=153, Evalue=6e-37,
Organism=Homo sapiens, GI40254938, Length=373, Percent_Identity=27.8820375335121, Blast_Score=147, Evalue=2e-35,
Organism=Homo sapiens, GI217035081, Length=355, Percent_Identity=26.4788732394366, Blast_Score=119, Evalue=7e-27,
Organism=Homo sapiens, GI34147522, Length=303, Percent_Identity=26.0726072607261, Blast_Score=85, Evalue=2e-16,
Organism=Homo sapiens, GI27363457, Length=303, Percent_Identity=26.7326732673267, Blast_Score=82, Evalue=1e-15,
Organism=Homo sapiens, GI217416386, Length=256, Percent_Identity=28.125, Blast_Score=78, Evalue=3e-14,
Organism=Escherichia coli, GI2367309, Length=378, Percent_Identity=29.8941798941799, Blast_Score=185, Evalue=6e-48,
Organism=Caenorhabditis elegans, GI17559152, Length=263, Percent_Identity=30.4182509505703, Blast_Score=134, Evalue=2e-31,
Organism=Caenorhabditis elegans, GI32565180, Length=313, Percent_Identity=24.2811501597444, Blast_Score=87, Evalue=2e-17,
Organism=Saccharomyces cerevisiae, GI6323282, Length=242, Percent_Identity=28.9256198347107, Blast_Score=107, Evalue=8e-24,
Organism=Saccharomyces cerevisiae, GI6321319, Length=263, Percent_Identity=25.8555133079848, Blast_Score=98, Evalue=4e-21,
Organism=Saccharomyces cerevisiae, GI6325148, Length=484, Percent_Identity=22.1074380165289, Blast_Score=86, Evalue=2e-17,
Organism=Drosophila melanogaster, GI24662575, Length=276, Percent_Identity=38.4057971014493, Blast_Score=177, Evalue=2e-44,
Organism=Drosophila melanogaster, GI22024280, Length=338, Percent_Identity=30.7692307692308, Blast_Score=153, Evalue=4e-37,
Organism=Drosophila melanogaster, GI18859849, Length=262, Percent_Identity=29.7709923664122, Blast_Score=98, Evalue=2e-20,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR004147
- InterPro:   IPR011009
- InterPro:   IPR000719 [H]

Pfam domain/function: PF03109 ABC1 [H]

EC number: NA

Molecular weight: Translated: 69557; Mature: 69557

Theoretical pI: Translated: 8.86; Mature: 8.86

Prosite motif: PS50011 PROTEIN_KINASE_DOM

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.5 %Cys     (Translated Protein)
1.8 %Met     (Translated Protein)
2.3 %Cys+Met (Translated Protein)
0.5 %Cys     (Mature Protein)
1.8 %Met     (Mature Protein)
2.3 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MRALNESTVEPRFESAALTRPGAGLPSAAAPDLPFKSYDPDLIARYAERRFGRVLWRFFQ
CCCCCCCCCCCCHHHHHCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHH
TLLPFVGFALQVQWDRLTGTVARHQLKRAVRLREILTRLGPTYIKIGQALSTRPDLVPPV
HHHHHHHHHHEEEHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHCCCCCCCCCH
YLDELTLLQDRLPPVPNAEAYALIRAGLGRDPHEIYAEFDEVPIAAASLGQVYRARLTTG
HHHHHHHHHHCCCCCCCCHHHHHHHHCCCCCHHHHHHHHHCCCHHHHHHHHHHHHHCCCC
ERVAVKVQRPNLIPLVSLDLYLQRGLLGWVERNVPQVKSDLQAILDEFGRKLFEEMDYVQ
CEEEEEEECCCCCEEHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHH
EGKNAERFAACFTEMPEVYVPRIYWDYTCRQVLTMEWIDGLKLTRLEDIQRAGLNARKVI
CCCCHHHHHHHHHHCCHHHCCHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHCCCCHHHHH
ENGVQCSLRQLLEHGFFHADPHPGNLLVMADGRLAYLDFGMMSEVEPAQRYGLIEAIVHM
HCCHHHHHHHHHHCCCCCCCCCCCCEEEEECCCEEEEECCHHHCCCHHHHHHHHHHHHHH
VNRDFDGLARDYVKLGFLKPDQDLKPIVPVLAVVFGQALGSSVGSLNIKSITDNMSSMMY
HCCCHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHH
DLPFRVPAFFALIIRSLVTLEGIAISVDPDFKVLEVAYPYVARRLLTDNAPELRASLSEL
HCCCHHHHHHHHHHHHHHHHCCEEEEECCCCHHHHHHHHHHHHHHHCCCCHHHHHHHHHH
LFKDGSFRWNRLENLVRNARSARDYDINRALDQAAEFLLSERGASIREKLIDELTSASTV
HHCCCCCCHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHCCCCC
NPNVPGGKASGLQNLERLWSLLREDPKLDLRKSVSILGKLILKPEGRDLSRRVAGRLLER
CCCCCCCCHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHH
ELARLLRRTLLPATLA
HHHHHHHHHHCCCCCC
>Mature Secondary Structure
MRALNESTVEPRFESAALTRPGAGLPSAAAPDLPFKSYDPDLIARYAERRFGRVLWRFFQ
CCCCCCCCCCCCHHHHHCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHH
TLLPFVGFALQVQWDRLTGTVARHQLKRAVRLREILTRLGPTYIKIGQALSTRPDLVPPV
HHHHHHHHHHEEEHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHCCCCCCCCCH
YLDELTLLQDRLPPVPNAEAYALIRAGLGRDPHEIYAEFDEVPIAAASLGQVYRARLTTG
HHHHHHHHHHCCCCCCCCHHHHHHHHCCCCCHHHHHHHHHCCCHHHHHHHHHHHHHCCCC
ERVAVKVQRPNLIPLVSLDLYLQRGLLGWVERNVPQVKSDLQAILDEFGRKLFEEMDYVQ
CEEEEEEECCCCCEEHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHH
EGKNAERFAACFTEMPEVYVPRIYWDYTCRQVLTMEWIDGLKLTRLEDIQRAGLNARKVI
CCCCHHHHHHHHHHCCHHHCCHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHCCCCHHHHH
ENGVQCSLRQLLEHGFFHADPHPGNLLVMADGRLAYLDFGMMSEVEPAQRYGLIEAIVHM
HCCHHHHHHHHHHCCCCCCCCCCCCEEEEECCCEEEEECCHHHCCCHHHHHHHHHHHHHH
VNRDFDGLARDYVKLGFLKPDQDLKPIVPVLAVVFGQALGSSVGSLNIKSITDNMSSMMY
HCCCHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHH
DLPFRVPAFFALIIRSLVTLEGIAISVDPDFKVLEVAYPYVARRLLTDNAPELRASLSEL
HCCCHHHHHHHHHHHHHHHHCCEEEEECCCCHHHHHHHHHHHHHHHCCCCHHHHHHHHHH
LFKDGSFRWNRLENLVRNARSARDYDINRALDQAAEFLLSERGASIREKLIDELTSASTV
HHCCCCCCHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHCCCCC
NPNVPGGKASGLQNLERLWSLLREDPKLDLRKSVSILGKLILKPEGRDLSRRVAGRLLER
CCCCCCCCHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHH
ELARLLRRTLLPATLA
HHHHHHHHHHCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: 2 2-octaprenylphenol; O2 [C]

Specific reaction: 2 2-octaprenylphenol + O2 = 2 2-octaprenyl-6-hydroxyphenol [C]

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 8590279; 8905231 [H]