Definition Deinococcus geothermalis DSM 11300 plasmid pDGEO01, complete sequence.
Accession NC_008010
Length 574,127

Click here to switch to the map view.

The map label for this gene is yjhT [C]

Identifier: 94972132

GI number: 94972132

Start: 370799

End: 372880

Strand: Direct

Name: yjhT [C]

Synonym: Dgeo_2665

Alternate gene names: 94972132

Gene position: 370799-372880 (Clockwise)

Preceding gene: 94972133

Following gene: 94972112

Centisome position: 64.58

GC content: 66.38

Gene sequence:

>2082_bases
GTGAAATCGCCCGTCCGTCTGATCTCGTCGGCGATGCTGCTGCTGGGAACCCTGCTGGGTCTGGGGGCCTGCACGGACGG
GGGCACGCCCGCCGCGAGCGACCCGTATGCGGGTGGGGTGAGCTATCCCTGGACCGATCAGACCCCCACCCCCGCCGATC
CCTACGCCTCTGGCATCAGCTACCCCTGGACCGGCCCCAGCGCCGCCTCCCTCCAACCCGCCGGCCTCAGTGGCGACAAC
AGCCTCTCTGACCTCTCCTGGACCCCCGGCTCCGCCGCCAACGCCTGGGGTCCCATCGAACTCAACCGCAGCAATGGCGA
AAAAAACGCCGGTGATGGCCGCACCCTCACCATCGGCGGCCAGTCCTTCCCCAAGGGCCTTGGCATGCACGCCAACGGTG
AAGTCAGCTACGCCACCGGCGGTTCCTGCTCCACCTTCACCGCCACCGTCGGCATCGACGACGAGGTCGGAGACCGTGGC
AGCGTCGTCTTCGAAGTCTGGGACGGCACCACCACCCGGCTCTATGCCACCCCGATCCTGCGCGGCAGTGACCCCCCCTT
CAACCTCACTGTCCCCCTCACCCGCCCGGACGGCAGCGCCGTCCGGGACCTGCGCCTGGTCGTCCGCGATGCCGGCGACG
GCATCTCCTACGATCACGCCGACTGGGCCAATCCCACCCTCAGCTGCAGCGCCACCCCCCCCTCCGGCGACGTCTTTGTC
TCCGACCTGGACTGGAACACCCCCAGCAACGGCTGGGGTCCCATCGAGCAAGACCTCAGCAACGGCGAAAAGGGCCTCGC
AGATGGCCGCACCCTCACCATCGGCGGCCAGTCCTTCCCCAAGGGTCTGGGCATGCACGCCAACGGCAGCGTGACCTACC
TGCTGGGAGGACGCTGCAGCACCTTCACCGCCAGCGTGGGGGTCGACGACGAGGTGGGAGACCGCGGTAGCGTGGTGTTT
CAAGTGTTTGGAGACGGCACCAAGCTCTATGACAGCGGGGTGCGGCGTGGAACCGACGGACCGCAGGCGCTGAACGTGAA
CGTGAGCGGCGTACAGCAGCTCAAACTGGTGGTGACCGACGCCGGCGACAGCATCTCCTACGACCACGCCGACTGGGCCA
ATGCCAAACTCAGCTGCTCCTCCGATACCAACACCCTCACCTATACCCCCATCGCCGACCAACCCTATGTCGTGGCCGAG
GCGATGGGCCAGGTGGTGAGGGGCAAACTCTATACTTTCGGCGGCTTTGACAGCCTGAAAAGCGGCTTTACTCCCACCGA
CCGCGCCTACGTATACGACCCGGACGCCAATACCTGGACGCCCATTGCGCGGATGCCCAACCGGGGGGCCACTCATGCGG
GCATGACCACCGACGGCACCGACATCTTTTACGCAGGCGGCTACGTCGCTGACGCAAACTGGACCGGGCAGGTGTTCGGC
AGCAAGGAAGTCTGGCGCTACAACGTGGCGAGCAATACCTATACCCGCTTGCCTGATCTGCCGGTGGCCCGCGCGGCGGG
TGGCCTGGAGTATCTGAACGGCAAACTGCACTACTTCGGCGGCACCAATCTGTCACGCCAGGACGTGGGGGATCACTTCG
TGCTTGATCTGGCCGGCGGCGCAACAAGCTGGACCACCGCCGCGCCGCTTCCCAACCCGCGCAATCACCTCGGGGCAGCG
GTGCTGGGCGGCAAGATCTACGCTGTTGGCGGTGCCCGCGGGCAGGACCAGAATTCCGTGCAGCAAACGGCGGTGCATGC
CTATGATCCCGCCACCAACACCTGGACTGCTGTGGCGAGCCTACCTCGGGGGCTTAGCCACAATGCCGACACCACCTTTG
TCCTGGGTGGCCGCATCATCGTCGCGGGTGGAGAAGTAGCCTACAACGTTTCTACGCGTGACGTGACCGCCTACAACCCG
GCGACGAACACCTGGACCCCGCTCACGCCCCTGCCCATCGGACGCGAGGCCAGCGTGGCCGATGCCCTCGGCAACGGCTT
CCTGTATACCGGCGGCAACCAGCCCGGGTGGGTCAAGTCGGGCTGGCGGGCGATGCCTCAAGCTGCTTCCAGCCAACCCT
AG

Upstream 100 bases:

>100_bases
TGGTCCCCATCAACAACGTGCAGGTGGCAGACGGACGGCTCACCATTCAGCTAAAGGCCCGCGTTGACTTTCCCGATCTC
TCCGGGATCGAGGTGACCCG

Downstream 100 bases:

>100_bases
CGCCTTTGACCAAGGCTCATCTTGCATTTGATGGGTAGTCCGTTGACTCGAAGCGAGAACATTGCAGAAAAACTACTTGT
CCTCACTCAGCGCAAAGCCC

Product: glycosy hydrolase family protein

Products: NA

Alternate protein names: Alpha-Galactosidase; Glycosy Hydrolase Family Protein; Glycosyl Hydrolase Family; Kelch Repeat Protein; Beta-Galactosidase; Peptidase S8 And; Protein Kinase; Kelch Repeat Type 1-Containing Protein; Secreted Protein; Leucine Rich Repeat Domain-Containing Protein; NHL Repeat Containing Protein; LuxR Family Transcriptional Regulator; Alpha-Glucosidase; Triacylglycerol Lipase; Ig Domain-Containing Domain-Containing Protein; Ring Canal Kelch-Like Protein; Alpha-Fucosidase; Metallophosphoesterase; LOW QUALITY PROTEIN Group; Regulator; Serine/Threonine Protein Kinase; Glycoside Hydrolase Family Protein; Peptidase S8/S53 Subtilisin Kexin Sedolisin; Kelch Motif-Containing Protein; Glycosyl Hydrolase; Endoglucanase-Related Protein; Discoidin Domain-Containing Protein; Secreted Alpha-Galactosidase; Response Regulator Receiver Protein; Sialidase

Number of amino acids: Translated: 693; Mature: 693

Protein sequence:

>693_residues
MKSPVRLISSAMLLLGTLLGLGACTDGGTPAASDPYAGGVSYPWTDQTPTPADPYASGISYPWTGPSAASLQPAGLSGDN
SLSDLSWTPGSAANAWGPIELNRSNGEKNAGDGRTLTIGGQSFPKGLGMHANGEVSYATGGSCSTFTATVGIDDEVGDRG
SVVFEVWDGTTTRLYATPILRGSDPPFNLTVPLTRPDGSAVRDLRLVVRDAGDGISYDHADWANPTLSCSATPPSGDVFV
SDLDWNTPSNGWGPIEQDLSNGEKGLADGRTLTIGGQSFPKGLGMHANGSVTYLLGGRCSTFTASVGVDDEVGDRGSVVF
QVFGDGTKLYDSGVRRGTDGPQALNVNVSGVQQLKLVVTDAGDSISYDHADWANAKLSCSSDTNTLTYTPIADQPYVVAE
AMGQVVRGKLYTFGGFDSLKSGFTPTDRAYVYDPDANTWTPIARMPNRGATHAGMTTDGTDIFYAGGYVADANWTGQVFG
SKEVWRYNVASNTYTRLPDLPVARAAGGLEYLNGKLHYFGGTNLSRQDVGDHFVLDLAGGATSWTTAAPLPNPRNHLGAA
VLGGKIYAVGGARGQDQNSVQQTAVHAYDPATNTWTAVASLPRGLSHNADTTFVLGGRIIVAGGEVAYNVSTRDVTAYNP
ATNTWTPLTPLPIGREASVADALGNGFLYTGGNQPGWVKSGWRAMPQAASSQP

Sequences:

>Translated_693_residues
MKSPVRLISSAMLLLGTLLGLGACTDGGTPAASDPYAGGVSYPWTDQTPTPADPYASGISYPWTGPSAASLQPAGLSGDN
SLSDLSWTPGSAANAWGPIELNRSNGEKNAGDGRTLTIGGQSFPKGLGMHANGEVSYATGGSCSTFTATVGIDDEVGDRG
SVVFEVWDGTTTRLYATPILRGSDPPFNLTVPLTRPDGSAVRDLRLVVRDAGDGISYDHADWANPTLSCSATPPSGDVFV
SDLDWNTPSNGWGPIEQDLSNGEKGLADGRTLTIGGQSFPKGLGMHANGSVTYLLGGRCSTFTASVGVDDEVGDRGSVVF
QVFGDGTKLYDSGVRRGTDGPQALNVNVSGVQQLKLVVTDAGDSISYDHADWANAKLSCSSDTNTLTYTPIADQPYVVAE
AMGQVVRGKLYTFGGFDSLKSGFTPTDRAYVYDPDANTWTPIARMPNRGATHAGMTTDGTDIFYAGGYVADANWTGQVFG
SKEVWRYNVASNTYTRLPDLPVARAAGGLEYLNGKLHYFGGTNLSRQDVGDHFVLDLAGGATSWTTAAPLPNPRNHLGAA
VLGGKIYAVGGARGQDQNSVQQTAVHAYDPATNTWTAVASLPRGLSHNADTTFVLGGRIIVAGGEVAYNVSTRDVTAYNP
ATNTWTPLTPLPIGREASVADALGNGFLYTGGNQPGWVKSGWRAMPQAASSQP
>Mature_693_residues
MKSPVRLISSAMLLLGTLLGLGACTDGGTPAASDPYAGGVSYPWTDQTPTPADPYASGISYPWTGPSAASLQPAGLSGDN
SLSDLSWTPGSAANAWGPIELNRSNGEKNAGDGRTLTIGGQSFPKGLGMHANGEVSYATGGSCSTFTATVGIDDEVGDRG
SVVFEVWDGTTTRLYATPILRGSDPPFNLTVPLTRPDGSAVRDLRLVVRDAGDGISYDHADWANPTLSCSATPPSGDVFV
SDLDWNTPSNGWGPIEQDLSNGEKGLADGRTLTIGGQSFPKGLGMHANGSVTYLLGGRCSTFTASVGVDDEVGDRGSVVF
QVFGDGTKLYDSGVRRGTDGPQALNVNVSGVQQLKLVVTDAGDSISYDHADWANAKLSCSSDTNTLTYTPIADQPYVVAE
AMGQVVRGKLYTFGGFDSLKSGFTPTDRAYVYDPDANTWTPIARMPNRGATHAGMTTDGTDIFYAGGYVADANWTGQVFG
SKEVWRYNVASNTYTRLPDLPVARAAGGLEYLNGKLHYFGGTNLSRQDVGDHFVLDLAGGATSWTTAAPLPNPRNHLGAA
VLGGKIYAVGGARGQDQNSVQQTAVHAYDPATNTWTAVASLPRGLSHNADTTFVLGGRIIVAGGEVAYNVSTRDVTAYNP
ATNTWTPLTPLPIGREASVADALGNGFLYTGGNQPGWVKSGWRAMPQAASSQP

Specific function: Unknown

COG id: COG3055

COG function: function code S; Uncharacterized protein conserved in bacteria

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

Organism=Homo sapiens, GI14780904, Length=262, Percent_Identity=30.9160305343511, Blast_Score=91, Evalue=5e-18,
Organism=Homo sapiens, GI55770880, Length=277, Percent_Identity=29.2418772563177, Blast_Score=87, Evalue=7e-17,
Organism=Homo sapiens, GI65289632, Length=277, Percent_Identity=29.2418772563177, Blast_Score=86, Evalue=9e-17,
Organism=Homo sapiens, GI65289292, Length=277, Percent_Identity=29.2418772563177, Blast_Score=86, Evalue=9e-17,
Organism=Homo sapiens, GI284413752, Length=277, Percent_Identity=29.2418772563177, Blast_Score=86, Evalue=2e-16,
Organism=Homo sapiens, GI40018614, Length=246, Percent_Identity=26.4227642276423, Blast_Score=84, Evalue=4e-16,
Organism=Homo sapiens, GI166235129, Length=268, Percent_Identity=29.8507462686567, Blast_Score=77, Evalue=4e-14,
Organism=Homo sapiens, GI259013520, Length=243, Percent_Identity=24.2798353909465, Blast_Score=76, Evalue=9e-14,
Organism=Homo sapiens, GI24475847, Length=191, Percent_Identity=28.7958115183246, Blast_Score=75, Evalue=3e-13,
Organism=Homo sapiens, GI44680141, Length=264, Percent_Identity=27.6515151515151, Blast_Score=75, Evalue=3e-13,
Organism=Homo sapiens, GI55925604, Length=188, Percent_Identity=33.5106382978723, Blast_Score=74, Evalue=6e-13,
Organism=Homo sapiens, GI148664209, Length=264, Percent_Identity=27.6515151515151, Blast_Score=72, Evalue=1e-12,
Organism=Homo sapiens, GI45269145, Length=256, Percent_Identity=30.46875, Blast_Score=71, Evalue=3e-12,
Organism=Homo sapiens, GI22027642, Length=256, Percent_Identity=30.46875, Blast_Score=71, Evalue=3e-12,
Organism=Homo sapiens, GI24432026, Length=191, Percent_Identity=31.9371727748691, Blast_Score=71, Evalue=4e-12,
Organism=Homo sapiens, GI239835724, Length=244, Percent_Identity=28.6885245901639, Blast_Score=70, Evalue=8e-12,
Organism=Homo sapiens, GI239835720, Length=244, Percent_Identity=28.6885245901639, Blast_Score=70, Evalue=1e-11,
Organism=Homo sapiens, GI5174473, Length=199, Percent_Identity=28.643216080402, Blast_Score=69, Evalue=1e-11,
Organism=Homo sapiens, GI239835722, Length=244, Percent_Identity=28.6885245901639, Blast_Score=69, Evalue=1e-11,
Organism=Homo sapiens, GI51479184, Length=273, Percent_Identity=28.2051282051282, Blast_Score=69, Evalue=1e-11,
Organism=Homo sapiens, GI223890235, Length=199, Percent_Identity=28.643216080402, Blast_Score=69, Evalue=2e-11,
Organism=Drosophila melanogaster, GI21356823, Length=251, Percent_Identity=33.8645418326693, Blast_Score=92, Evalue=9e-19,
Organism=Drosophila melanogaster, GI24646172, Length=251, Percent_Identity=33.8645418326693, Blast_Score=92, Evalue=1e-18,
Organism=Drosophila melanogaster, GI28571155, Length=274, Percent_Identity=28.1021897810219, Blast_Score=83, Evalue=6e-16,
Organism=Drosophila melanogaster, GI45549356, Length=274, Percent_Identity=28.1021897810219, Blast_Score=83, Evalue=7e-16,
Organism=Drosophila melanogaster, GI24640793, Length=274, Percent_Identity=28.1021897810219, Blast_Score=83, Evalue=7e-16,
Organism=Drosophila melanogaster, GI28572989, Length=216, Percent_Identity=29.1666666666667, Blast_Score=78, Evalue=2e-14,
Organism=Drosophila melanogaster, GI24647597, Length=216, Percent_Identity=29.1666666666667, Blast_Score=78, Evalue=2e-14,
Organism=Drosophila melanogaster, GI45551913, Length=216, Percent_Identity=29.1666666666667, Blast_Score=78, Evalue=2e-14,
Organism=Drosophila melanogaster, GI24664829, Length=249, Percent_Identity=27.3092369477912, Blast_Score=73, Evalue=8e-13,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 72313; Mature: 72313

Theoretical pI: Translated: 4.67; Mature: 4.67

Prosite motif: PS00013 PROKAR_LIPOPROTEIN

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.7 %Cys     (Translated Protein)
1.2 %Met     (Translated Protein)
1.9 %Cys+Met (Translated Protein)
0.7 %Cys     (Mature Protein)
1.2 %Met     (Mature Protein)
1.9 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKSPVRLISSAMLLLGTLLGLGACTDGGTPAASDPYAGGVSYPWTDQTPTPADPYASGIS
CCCHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHCCCC
YPWTGPSAASLQPAGLSGDNSLSDLSWTPGSAANAWGPIELNRSNGEKNAGDGRTLTIGG
CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCEEEECCCCCCCCCCCCEEEECC
QSFPKGLGMHANGEVSYATGGSCSTFTATVGIDDEVGDRGSVVFEVWDGTTTRLYATPIL
CCCCCCCCCCCCCEEEEECCCCCCEEEEEECCCCCCCCCCCEEEEEECCCCEEEEEEEEE
RGSDPPFNLTVPLTRPDGSAVRDLRLVVRDAGDGISYDHADWANPTLSCSATPPSGDVFV
CCCCCCEEEEEEEECCCCHHHHHEEEEEEECCCCCCCCCCCCCCCEEEEECCCCCCCEEE
SDLDWNTPSNGWGPIEQDLSNGEKGLADGRTLTIGGQSFPKGLGMHANGSVTYLLGGRCS
EECCCCCCCCCCCCHHHHHCCCCCCCCCCCEEEECCCCCCCCCCCCCCCCEEEEECCCCC
TFTASVGVDDEVGDRGSVVFQVFGDGTKLYDSGVRRGTDGPQALNVNVSGVQQLKLVVTD
EEEEECCCCCCCCCCCCEEEEEECCCCEEHHHHCCCCCCCCEEEEEECCCCEEEEEEEEE
AGDSISYDHADWANAKLSCSSDTNTLTYTPIADQPYVVAEAMGQVVRGKLYTFGGFDSLK
CCCCCCCCCCCCCCCEEEECCCCCEEEEECCCCCCCHHHHHHHHHHCCEEEEECCHHHHH
SGFTPTDRAYVYDPDANTWTPIARMPNRGATHAGMTTDGTDIFYAGGYVADANWTGQVFG
CCCCCCCCEEEECCCCCCCCHHHCCCCCCCCCCCCCCCCCEEEEECCEEECCCCCEEECC
SKEVWRYNVASNTYTRLPDLPVARAAGGLEYLNGKLHYFGGTNLSRQDVGDHFVLDLAGG
CCCEEEEECCCCCEECCCCCCHHHHCCCHHHHCCEEEEECCCCCCHHHCCCEEEEEECCC
ATSWTTAAPLPNPRNHLGAAVLGGKIYAVGGARGQDQNSVQQTAVHAYDPATNTWTAVAS
CCCCCCCCCCCCCHHHCCEEEECCEEEEECCCCCCCCHHHHHHEEEEECCCCCCCHHHHH
LPRGLSHNADTTFVLGGRIIVAGGEVAYNVSTRDVTAYNPATNTWTPLTPLPIGREASVA
CCCCCCCCCCEEEEECCEEEEECCEEEEEECCCEEEEECCCCCCCCCCCCCCCCCCCHHH
DALGNGFLYTGGNQPGWVKSGWRAMPQAASSQP
HHHCCCEEEECCCCCCCCCCCCHHCCCCCCCCC
>Mature Secondary Structure
MKSPVRLISSAMLLLGTLLGLGACTDGGTPAASDPYAGGVSYPWTDQTPTPADPYASGIS
CCCHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHCCCC
YPWTGPSAASLQPAGLSGDNSLSDLSWTPGSAANAWGPIELNRSNGEKNAGDGRTLTIGG
CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCEEEECCCCCCCCCCCCEEEECC
QSFPKGLGMHANGEVSYATGGSCSTFTATVGIDDEVGDRGSVVFEVWDGTTTRLYATPIL
CCCCCCCCCCCCCEEEEECCCCCCEEEEEECCCCCCCCCCCEEEEEECCCCEEEEEEEEE
RGSDPPFNLTVPLTRPDGSAVRDLRLVVRDAGDGISYDHADWANPTLSCSATPPSGDVFV
CCCCCCEEEEEEEECCCCHHHHHEEEEEEECCCCCCCCCCCCCCCEEEEECCCCCCCEEE
SDLDWNTPSNGWGPIEQDLSNGEKGLADGRTLTIGGQSFPKGLGMHANGSVTYLLGGRCS
EECCCCCCCCCCCCHHHHHCCCCCCCCCCCEEEECCCCCCCCCCCCCCCCEEEEECCCCC
TFTASVGVDDEVGDRGSVVFQVFGDGTKLYDSGVRRGTDGPQALNVNVSGVQQLKLVVTD
EEEEECCCCCCCCCCCCEEEEEECCCCEEHHHHCCCCCCCCEEEEEECCCCEEEEEEEEE
AGDSISYDHADWANAKLSCSSDTNTLTYTPIADQPYVVAEAMGQVVRGKLYTFGGFDSLK
CCCCCCCCCCCCCCCEEEECCCCCEEEEECCCCCCCHHHHHHHHHHCCEEEEECCHHHHH
SGFTPTDRAYVYDPDANTWTPIARMPNRGATHAGMTTDGTDIFYAGGYVADANWTGQVFG
CCCCCCCCEEEECCCCCCCCHHHCCCCCCCCCCCCCCCCCEEEEECCEEECCCCCEEECC
SKEVWRYNVASNTYTRLPDLPVARAAGGLEYLNGKLHYFGGTNLSRQDVGDHFVLDLAGG
CCCEEEEECCCCCEECCCCCCHHHHCCCHHHHCCEEEEECCCCCCHHHCCCEEEEEECCC
ATSWTTAAPLPNPRNHLGAAVLGGKIYAVGGARGQDQNSVQQTAVHAYDPATNTWTAVAS
CCCCCCCCCCCCCHHHCCEEEECCEEEEECCCCCCCCHHHHHHEEEEECCCCCCCHHHHH
LPRGLSHNADTTFVLGGRIIVAGGEVAYNVSTRDVTAYNPATNTWTPLTPLPIGREASVA
CCCCCCCCCCEEEEECCEEEEECCEEEEEECCCEEEEECCCCCCCCCCCCCCCCCCCHHH
DALGNGFLYTGGNQPGWVKSGWRAMPQAASSQP
HHHCCCEEEECCCCCCCCCCCCHHCCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA