| Definition | Deinococcus geothermalis DSM 11300 plasmid pDGEO01, complete sequence. |
|---|---|
| Accession | NC_008010 |
| Length | 574,127 |
Click here to switch to the map view.
The map label for this gene is yjhT [C]
Identifier: 94972132
GI number: 94972132
Start: 370799
End: 372880
Strand: Direct
Name: yjhT [C]
Synonym: Dgeo_2665
Alternate gene names: 94972132
Gene position: 370799-372880 (Clockwise)
Preceding gene: 94972133
Following gene: 94972112
Centisome position: 64.58
GC content: 66.38
Gene sequence:
>2082_bases GTGAAATCGCCCGTCCGTCTGATCTCGTCGGCGATGCTGCTGCTGGGAACCCTGCTGGGTCTGGGGGCCTGCACGGACGG GGGCACGCCCGCCGCGAGCGACCCGTATGCGGGTGGGGTGAGCTATCCCTGGACCGATCAGACCCCCACCCCCGCCGATC CCTACGCCTCTGGCATCAGCTACCCCTGGACCGGCCCCAGCGCCGCCTCCCTCCAACCCGCCGGCCTCAGTGGCGACAAC AGCCTCTCTGACCTCTCCTGGACCCCCGGCTCCGCCGCCAACGCCTGGGGTCCCATCGAACTCAACCGCAGCAATGGCGA AAAAAACGCCGGTGATGGCCGCACCCTCACCATCGGCGGCCAGTCCTTCCCCAAGGGCCTTGGCATGCACGCCAACGGTG AAGTCAGCTACGCCACCGGCGGTTCCTGCTCCACCTTCACCGCCACCGTCGGCATCGACGACGAGGTCGGAGACCGTGGC AGCGTCGTCTTCGAAGTCTGGGACGGCACCACCACCCGGCTCTATGCCACCCCGATCCTGCGCGGCAGTGACCCCCCCTT CAACCTCACTGTCCCCCTCACCCGCCCGGACGGCAGCGCCGTCCGGGACCTGCGCCTGGTCGTCCGCGATGCCGGCGACG GCATCTCCTACGATCACGCCGACTGGGCCAATCCCACCCTCAGCTGCAGCGCCACCCCCCCCTCCGGCGACGTCTTTGTC TCCGACCTGGACTGGAACACCCCCAGCAACGGCTGGGGTCCCATCGAGCAAGACCTCAGCAACGGCGAAAAGGGCCTCGC AGATGGCCGCACCCTCACCATCGGCGGCCAGTCCTTCCCCAAGGGTCTGGGCATGCACGCCAACGGCAGCGTGACCTACC TGCTGGGAGGACGCTGCAGCACCTTCACCGCCAGCGTGGGGGTCGACGACGAGGTGGGAGACCGCGGTAGCGTGGTGTTT CAAGTGTTTGGAGACGGCACCAAGCTCTATGACAGCGGGGTGCGGCGTGGAACCGACGGACCGCAGGCGCTGAACGTGAA CGTGAGCGGCGTACAGCAGCTCAAACTGGTGGTGACCGACGCCGGCGACAGCATCTCCTACGACCACGCCGACTGGGCCA ATGCCAAACTCAGCTGCTCCTCCGATACCAACACCCTCACCTATACCCCCATCGCCGACCAACCCTATGTCGTGGCCGAG GCGATGGGCCAGGTGGTGAGGGGCAAACTCTATACTTTCGGCGGCTTTGACAGCCTGAAAAGCGGCTTTACTCCCACCGA CCGCGCCTACGTATACGACCCGGACGCCAATACCTGGACGCCCATTGCGCGGATGCCCAACCGGGGGGCCACTCATGCGG GCATGACCACCGACGGCACCGACATCTTTTACGCAGGCGGCTACGTCGCTGACGCAAACTGGACCGGGCAGGTGTTCGGC AGCAAGGAAGTCTGGCGCTACAACGTGGCGAGCAATACCTATACCCGCTTGCCTGATCTGCCGGTGGCCCGCGCGGCGGG TGGCCTGGAGTATCTGAACGGCAAACTGCACTACTTCGGCGGCACCAATCTGTCACGCCAGGACGTGGGGGATCACTTCG TGCTTGATCTGGCCGGCGGCGCAACAAGCTGGACCACCGCCGCGCCGCTTCCCAACCCGCGCAATCACCTCGGGGCAGCG GTGCTGGGCGGCAAGATCTACGCTGTTGGCGGTGCCCGCGGGCAGGACCAGAATTCCGTGCAGCAAACGGCGGTGCATGC CTATGATCCCGCCACCAACACCTGGACTGCTGTGGCGAGCCTACCTCGGGGGCTTAGCCACAATGCCGACACCACCTTTG TCCTGGGTGGCCGCATCATCGTCGCGGGTGGAGAAGTAGCCTACAACGTTTCTACGCGTGACGTGACCGCCTACAACCCG GCGACGAACACCTGGACCCCGCTCACGCCCCTGCCCATCGGACGCGAGGCCAGCGTGGCCGATGCCCTCGGCAACGGCTT CCTGTATACCGGCGGCAACCAGCCCGGGTGGGTCAAGTCGGGCTGGCGGGCGATGCCTCAAGCTGCTTCCAGCCAACCCT AG
Upstream 100 bases:
>100_bases TGGTCCCCATCAACAACGTGCAGGTGGCAGACGGACGGCTCACCATTCAGCTAAAGGCCCGCGTTGACTTTCCCGATCTC TCCGGGATCGAGGTGACCCG
Downstream 100 bases:
>100_bases CGCCTTTGACCAAGGCTCATCTTGCATTTGATGGGTAGTCCGTTGACTCGAAGCGAGAACATTGCAGAAAAACTACTTGT CCTCACTCAGCGCAAAGCCC
Product: glycosy hydrolase family protein
Products: NA
Alternate protein names: Alpha-Galactosidase; Glycosy Hydrolase Family Protein; Glycosyl Hydrolase Family; Kelch Repeat Protein; Beta-Galactosidase; Peptidase S8 And; Protein Kinase; Kelch Repeat Type 1-Containing Protein; Secreted Protein; Leucine Rich Repeat Domain-Containing Protein; NHL Repeat Containing Protein; LuxR Family Transcriptional Regulator; Alpha-Glucosidase; Triacylglycerol Lipase; Ig Domain-Containing Domain-Containing Protein; Ring Canal Kelch-Like Protein; Alpha-Fucosidase; Metallophosphoesterase; LOW QUALITY PROTEIN Group; Regulator; Serine/Threonine Protein Kinase; Glycoside Hydrolase Family Protein; Peptidase S8/S53 Subtilisin Kexin Sedolisin; Kelch Motif-Containing Protein; Glycosyl Hydrolase; Endoglucanase-Related Protein; Discoidin Domain-Containing Protein; Secreted Alpha-Galactosidase; Response Regulator Receiver Protein; Sialidase
Number of amino acids: Translated: 693; Mature: 693
Protein sequence:
>693_residues MKSPVRLISSAMLLLGTLLGLGACTDGGTPAASDPYAGGVSYPWTDQTPTPADPYASGISYPWTGPSAASLQPAGLSGDN SLSDLSWTPGSAANAWGPIELNRSNGEKNAGDGRTLTIGGQSFPKGLGMHANGEVSYATGGSCSTFTATVGIDDEVGDRG SVVFEVWDGTTTRLYATPILRGSDPPFNLTVPLTRPDGSAVRDLRLVVRDAGDGISYDHADWANPTLSCSATPPSGDVFV SDLDWNTPSNGWGPIEQDLSNGEKGLADGRTLTIGGQSFPKGLGMHANGSVTYLLGGRCSTFTASVGVDDEVGDRGSVVF QVFGDGTKLYDSGVRRGTDGPQALNVNVSGVQQLKLVVTDAGDSISYDHADWANAKLSCSSDTNTLTYTPIADQPYVVAE AMGQVVRGKLYTFGGFDSLKSGFTPTDRAYVYDPDANTWTPIARMPNRGATHAGMTTDGTDIFYAGGYVADANWTGQVFG SKEVWRYNVASNTYTRLPDLPVARAAGGLEYLNGKLHYFGGTNLSRQDVGDHFVLDLAGGATSWTTAAPLPNPRNHLGAA VLGGKIYAVGGARGQDQNSVQQTAVHAYDPATNTWTAVASLPRGLSHNADTTFVLGGRIIVAGGEVAYNVSTRDVTAYNP ATNTWTPLTPLPIGREASVADALGNGFLYTGGNQPGWVKSGWRAMPQAASSQP
Sequences:
>Translated_693_residues MKSPVRLISSAMLLLGTLLGLGACTDGGTPAASDPYAGGVSYPWTDQTPTPADPYASGISYPWTGPSAASLQPAGLSGDN SLSDLSWTPGSAANAWGPIELNRSNGEKNAGDGRTLTIGGQSFPKGLGMHANGEVSYATGGSCSTFTATVGIDDEVGDRG SVVFEVWDGTTTRLYATPILRGSDPPFNLTVPLTRPDGSAVRDLRLVVRDAGDGISYDHADWANPTLSCSATPPSGDVFV SDLDWNTPSNGWGPIEQDLSNGEKGLADGRTLTIGGQSFPKGLGMHANGSVTYLLGGRCSTFTASVGVDDEVGDRGSVVF QVFGDGTKLYDSGVRRGTDGPQALNVNVSGVQQLKLVVTDAGDSISYDHADWANAKLSCSSDTNTLTYTPIADQPYVVAE AMGQVVRGKLYTFGGFDSLKSGFTPTDRAYVYDPDANTWTPIARMPNRGATHAGMTTDGTDIFYAGGYVADANWTGQVFG SKEVWRYNVASNTYTRLPDLPVARAAGGLEYLNGKLHYFGGTNLSRQDVGDHFVLDLAGGATSWTTAAPLPNPRNHLGAA VLGGKIYAVGGARGQDQNSVQQTAVHAYDPATNTWTAVASLPRGLSHNADTTFVLGGRIIVAGGEVAYNVSTRDVTAYNP ATNTWTPLTPLPIGREASVADALGNGFLYTGGNQPGWVKSGWRAMPQAASSQP >Mature_693_residues MKSPVRLISSAMLLLGTLLGLGACTDGGTPAASDPYAGGVSYPWTDQTPTPADPYASGISYPWTGPSAASLQPAGLSGDN SLSDLSWTPGSAANAWGPIELNRSNGEKNAGDGRTLTIGGQSFPKGLGMHANGEVSYATGGSCSTFTATVGIDDEVGDRG SVVFEVWDGTTTRLYATPILRGSDPPFNLTVPLTRPDGSAVRDLRLVVRDAGDGISYDHADWANPTLSCSATPPSGDVFV SDLDWNTPSNGWGPIEQDLSNGEKGLADGRTLTIGGQSFPKGLGMHANGSVTYLLGGRCSTFTASVGVDDEVGDRGSVVF QVFGDGTKLYDSGVRRGTDGPQALNVNVSGVQQLKLVVTDAGDSISYDHADWANAKLSCSSDTNTLTYTPIADQPYVVAE AMGQVVRGKLYTFGGFDSLKSGFTPTDRAYVYDPDANTWTPIARMPNRGATHAGMTTDGTDIFYAGGYVADANWTGQVFG SKEVWRYNVASNTYTRLPDLPVARAAGGLEYLNGKLHYFGGTNLSRQDVGDHFVLDLAGGATSWTTAAPLPNPRNHLGAA VLGGKIYAVGGARGQDQNSVQQTAVHAYDPATNTWTAVASLPRGLSHNADTTFVLGGRIIVAGGEVAYNVSTRDVTAYNP ATNTWTPLTPLPIGREASVADALGNGFLYTGGNQPGWVKSGWRAMPQAASSQP
Specific function: Unknown
COG id: COG3055
COG function: function code S; Uncharacterized protein conserved in bacteria
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: NA
Homologues:
Organism=Homo sapiens, GI14780904, Length=262, Percent_Identity=30.9160305343511, Blast_Score=91, Evalue=5e-18, Organism=Homo sapiens, GI55770880, Length=277, Percent_Identity=29.2418772563177, Blast_Score=87, Evalue=7e-17, Organism=Homo sapiens, GI65289632, Length=277, Percent_Identity=29.2418772563177, Blast_Score=86, Evalue=9e-17, Organism=Homo sapiens, GI65289292, Length=277, Percent_Identity=29.2418772563177, Blast_Score=86, Evalue=9e-17, Organism=Homo sapiens, GI284413752, Length=277, Percent_Identity=29.2418772563177, Blast_Score=86, Evalue=2e-16, Organism=Homo sapiens, GI40018614, Length=246, Percent_Identity=26.4227642276423, Blast_Score=84, Evalue=4e-16, Organism=Homo sapiens, GI166235129, Length=268, Percent_Identity=29.8507462686567, Blast_Score=77, Evalue=4e-14, Organism=Homo sapiens, GI259013520, Length=243, Percent_Identity=24.2798353909465, Blast_Score=76, Evalue=9e-14, Organism=Homo sapiens, GI24475847, Length=191, Percent_Identity=28.7958115183246, Blast_Score=75, Evalue=3e-13, Organism=Homo sapiens, GI44680141, Length=264, Percent_Identity=27.6515151515151, Blast_Score=75, Evalue=3e-13, Organism=Homo sapiens, GI55925604, Length=188, Percent_Identity=33.5106382978723, Blast_Score=74, Evalue=6e-13, Organism=Homo sapiens, GI148664209, Length=264, Percent_Identity=27.6515151515151, Blast_Score=72, Evalue=1e-12, Organism=Homo sapiens, GI45269145, Length=256, Percent_Identity=30.46875, Blast_Score=71, Evalue=3e-12, Organism=Homo sapiens, GI22027642, Length=256, Percent_Identity=30.46875, Blast_Score=71, Evalue=3e-12, Organism=Homo sapiens, GI24432026, Length=191, Percent_Identity=31.9371727748691, Blast_Score=71, Evalue=4e-12, Organism=Homo sapiens, GI239835724, Length=244, Percent_Identity=28.6885245901639, Blast_Score=70, Evalue=8e-12, Organism=Homo sapiens, GI239835720, Length=244, Percent_Identity=28.6885245901639, Blast_Score=70, Evalue=1e-11, Organism=Homo sapiens, GI5174473, Length=199, Percent_Identity=28.643216080402, Blast_Score=69, Evalue=1e-11, Organism=Homo sapiens, GI239835722, Length=244, Percent_Identity=28.6885245901639, Blast_Score=69, Evalue=1e-11, Organism=Homo sapiens, GI51479184, Length=273, Percent_Identity=28.2051282051282, Blast_Score=69, Evalue=1e-11, Organism=Homo sapiens, GI223890235, Length=199, Percent_Identity=28.643216080402, Blast_Score=69, Evalue=2e-11, Organism=Drosophila melanogaster, GI21356823, Length=251, Percent_Identity=33.8645418326693, Blast_Score=92, Evalue=9e-19, Organism=Drosophila melanogaster, GI24646172, Length=251, Percent_Identity=33.8645418326693, Blast_Score=92, Evalue=1e-18, Organism=Drosophila melanogaster, GI28571155, Length=274, Percent_Identity=28.1021897810219, Blast_Score=83, Evalue=6e-16, Organism=Drosophila melanogaster, GI45549356, Length=274, Percent_Identity=28.1021897810219, Blast_Score=83, Evalue=7e-16, Organism=Drosophila melanogaster, GI24640793, Length=274, Percent_Identity=28.1021897810219, Blast_Score=83, Evalue=7e-16, Organism=Drosophila melanogaster, GI28572989, Length=216, Percent_Identity=29.1666666666667, Blast_Score=78, Evalue=2e-14, Organism=Drosophila melanogaster, GI24647597, Length=216, Percent_Identity=29.1666666666667, Blast_Score=78, Evalue=2e-14, Organism=Drosophila melanogaster, GI45551913, Length=216, Percent_Identity=29.1666666666667, Blast_Score=78, Evalue=2e-14, Organism=Drosophila melanogaster, GI24664829, Length=249, Percent_Identity=27.3092369477912, Blast_Score=73, Evalue=8e-13,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
NA
Pfam domain/function: NA
EC number: NA
Molecular weight: Translated: 72313; Mature: 72313
Theoretical pI: Translated: 4.67; Mature: 4.67
Prosite motif: PS00013 PROKAR_LIPOPROTEIN
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.7 %Cys (Translated Protein) 1.2 %Met (Translated Protein) 1.9 %Cys+Met (Translated Protein) 0.7 %Cys (Mature Protein) 1.2 %Met (Mature Protein) 1.9 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MKSPVRLISSAMLLLGTLLGLGACTDGGTPAASDPYAGGVSYPWTDQTPTPADPYASGIS CCCHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHCCCC YPWTGPSAASLQPAGLSGDNSLSDLSWTPGSAANAWGPIELNRSNGEKNAGDGRTLTIGG CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCEEEECCCCCCCCCCCCEEEECC QSFPKGLGMHANGEVSYATGGSCSTFTATVGIDDEVGDRGSVVFEVWDGTTTRLYATPIL CCCCCCCCCCCCCEEEEECCCCCCEEEEEECCCCCCCCCCCEEEEEECCCCEEEEEEEEE RGSDPPFNLTVPLTRPDGSAVRDLRLVVRDAGDGISYDHADWANPTLSCSATPPSGDVFV CCCCCCEEEEEEEECCCCHHHHHEEEEEEECCCCCCCCCCCCCCCEEEEECCCCCCCEEE SDLDWNTPSNGWGPIEQDLSNGEKGLADGRTLTIGGQSFPKGLGMHANGSVTYLLGGRCS EECCCCCCCCCCCCHHHHHCCCCCCCCCCCEEEECCCCCCCCCCCCCCCCEEEEECCCCC TFTASVGVDDEVGDRGSVVFQVFGDGTKLYDSGVRRGTDGPQALNVNVSGVQQLKLVVTD EEEEECCCCCCCCCCCCEEEEEECCCCEEHHHHCCCCCCCCEEEEEECCCCEEEEEEEEE AGDSISYDHADWANAKLSCSSDTNTLTYTPIADQPYVVAEAMGQVVRGKLYTFGGFDSLK CCCCCCCCCCCCCCCEEEECCCCCEEEEECCCCCCCHHHHHHHHHHCCEEEEECCHHHHH SGFTPTDRAYVYDPDANTWTPIARMPNRGATHAGMTTDGTDIFYAGGYVADANWTGQVFG CCCCCCCCEEEECCCCCCCCHHHCCCCCCCCCCCCCCCCCEEEEECCEEECCCCCEEECC SKEVWRYNVASNTYTRLPDLPVARAAGGLEYLNGKLHYFGGTNLSRQDVGDHFVLDLAGG CCCEEEEECCCCCEECCCCCCHHHHCCCHHHHCCEEEEECCCCCCHHHCCCEEEEEECCC ATSWTTAAPLPNPRNHLGAAVLGGKIYAVGGARGQDQNSVQQTAVHAYDPATNTWTAVAS CCCCCCCCCCCCCHHHCCEEEECCEEEEECCCCCCCCHHHHHHEEEEECCCCCCCHHHHH LPRGLSHNADTTFVLGGRIIVAGGEVAYNVSTRDVTAYNPATNTWTPLTPLPIGREASVA CCCCCCCCCCEEEEECCEEEEECCEEEEEECCCEEEEECCCCCCCCCCCCCCCCCCCHHH DALGNGFLYTGGNQPGWVKSGWRAMPQAASSQP HHHCCCEEEECCCCCCCCCCCCHHCCCCCCCCC >Mature Secondary Structure MKSPVRLISSAMLLLGTLLGLGACTDGGTPAASDPYAGGVSYPWTDQTPTPADPYASGIS CCCHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHCCCC YPWTGPSAASLQPAGLSGDNSLSDLSWTPGSAANAWGPIELNRSNGEKNAGDGRTLTIGG CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCEEEECCCCCCCCCCCCEEEECC QSFPKGLGMHANGEVSYATGGSCSTFTATVGIDDEVGDRGSVVFEVWDGTTTRLYATPIL CCCCCCCCCCCCCEEEEECCCCCCEEEEEECCCCCCCCCCCEEEEEECCCCEEEEEEEEE RGSDPPFNLTVPLTRPDGSAVRDLRLVVRDAGDGISYDHADWANPTLSCSATPPSGDVFV CCCCCCEEEEEEEECCCCHHHHHEEEEEEECCCCCCCCCCCCCCCEEEEECCCCCCCEEE SDLDWNTPSNGWGPIEQDLSNGEKGLADGRTLTIGGQSFPKGLGMHANGSVTYLLGGRCS EECCCCCCCCCCCCHHHHHCCCCCCCCCCCEEEECCCCCCCCCCCCCCCCEEEEECCCCC TFTASVGVDDEVGDRGSVVFQVFGDGTKLYDSGVRRGTDGPQALNVNVSGVQQLKLVVTD EEEEECCCCCCCCCCCCEEEEEECCCCEEHHHHCCCCCCCCEEEEEECCCCEEEEEEEEE AGDSISYDHADWANAKLSCSSDTNTLTYTPIADQPYVVAEAMGQVVRGKLYTFGGFDSLK CCCCCCCCCCCCCCCEEEECCCCCEEEEECCCCCCCHHHHHHHHHHCCEEEEECCHHHHH SGFTPTDRAYVYDPDANTWTPIARMPNRGATHAGMTTDGTDIFYAGGYVADANWTGQVFG CCCCCCCCEEEECCCCCCCCHHHCCCCCCCCCCCCCCCCCEEEEECCEEECCCCCEEECC SKEVWRYNVASNTYTRLPDLPVARAAGGLEYLNGKLHYFGGTNLSRQDVGDHFVLDLAGG CCCEEEEECCCCCEECCCCCCHHHHCCCHHHHCCEEEEECCCCCCHHHCCCEEEEEECCC ATSWTTAAPLPNPRNHLGAAVLGGKIYAVGGARGQDQNSVQQTAVHAYDPATNTWTAVAS CCCCCCCCCCCCCHHHCCEEEECCEEEEECCCCCCCCHHHHHHEEEEECCCCCCCHHHHH LPRGLSHNADTTFVLGGRIIVAGGEVAYNVSTRDVTAYNPATNTWTPLTPLPIGREASVA CCCCCCCCCCEEEEECCEEEEECCEEEEEECCCEEEEECCCCCCCCCCCCCCCCCCCHHH DALGNGFLYTGGNQPGWVKSGWRAMPQAASSQP HHHCCCEEEECCCCCCCCCCCCHHCCCCCCCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: NA