| Definition | Methanocorpusculum labreanum Z chromosome, complete genome. |
|---|---|
| Accession | NC_008942 |
| Length | 1,804,962 |
Click here to switch to the map view.
The map label for this gene is yoaA [C]
Identifier: 124485924
GI number: 124485924
Start: 1115463
End: 1117493
Strand: Reverse
Name: yoaA [C]
Synonym: Mlab_1104
Alternate gene names: 124485924
Gene position: 1117493-1115463 (Counterclockwise)
Preceding gene: 124485927
Following gene: 124485923
Centisome position: 61.91
GC content: 53.37
Gene sequence:
>2031_bases ATGGCAGACACAGCTGACTTTTTTCCCTATCAAACCTACCGGAAAAACCAAAAGGAAATGCTCGAAGAGGTAGAAAAAAC CGCCGAAGAAAACGGCATCCTCTTAATTGACGCACCGACCGGCAGCGGGAAATCCAGCGTGATCGCAAGTCTCCTTGCTA AAGCCAACGGACGAAAGATCCTCGTCGCCGTCAGAACCATATCCCAGCTCCAGATCTTCATTCGGGAACTCGACCTCATC AGGCAGAAAAAACAGCCGACCCTTAAATTCGTTTACCTTATTGGAAAGGGAAACATGTGCCCTCTCGGAGGATACGGGGA TGTCTACCGAAGATGCGAAGGCGTCAAAGCATTCACCTCGGCACTTATGCAGCAGAGGGCAGACCGCGGTTCATTCGATC CGGCAACCGACAAACAGATTCTCGAGCAGATCAGAAAGCAGGATCGGGAACATCCTCTCATTTGTCCCTACTTCGTCAAC AGCCGGGTCTTTGTCCAGAGCGAAGAGGGCGGGCGGCGCATGATCCCTTCCCCGGAACTCAGACGCAAATCCGATATTGC TCAGAAACAGATCGTCCGACCAAACGAACTTCTGAATTTCGCGGGCAAGGTCTGTCCCTACGACCTCATGCTCTCGGCCG CCAAGGGAGCTGATGTGATCATCTGTAACTACTATCACCTCTTCAACGACGATATCAGAGAGCAGCTGTACGTCAATCTT CAGTGCGAGGAGCACAACGTCATGCTCCTCCTTGATGAAGCCCACAACTTAGGCGACGTCATTCAGACGATCCAGAGCAT TCGGATACGGGACACCGACATCGAAGCCGCGGCAAACGAAGTCGCTTCACTCCGCGATAAGGTCCGCGGTTCCGAAGCGG TCCGCCATATCCTCCCGAGAATTGCCGAGTTCATCGACGGGCTCCAGCGTTCGAACGAGGCAGAGGACTGGTTTGACCCG CAGATCTTCAACCGGTTCATCATCAAAGGTTCTCTGTATGGAAAACCCGAGGCGATGCTCGAAGATATCATTTCCATCAA AGAGGCTATGCGCGAACGCGGCATCGAACGGGGCGACTACCGCGAATCGGCGATCGAAAAACTCTGCGAATTTTTGATCC GGCTCTACCGCTCTTCCACCGACCCGTCGTTTCTGACCGTTTACACCAAAGACGCCGAGACCATCACGCTTGAGGTCAGA AACATCGATCCGGCCGATCGGCTCCAAGAGCTCGTCTCCAAACATGCAGCAACCATTCTGATCAGCGGAACGCTGTCGCC GGTCGATTCCTACAGGAAATACTACTTCGGCAGCATGCCTGTCAAAACCCTCTCGCTTGCCAACTCGTTTCCCAAAGAAA ACCGCCTGGTTCTTGGGACCCGGGACATCACCACGGCATTTTCCAAACGCCAGAACGCCGAGAACACTCAGGCAATTGTG GAGTATATTCTTGCCTTTGCCAAACTCCCAGGAAACATCGCGGTCTACTTCCCTTCCTATCAGTTGCAGAACCGTTTTGC CGAAGCATGCGTAAGCAAGATTCGAAACAAACAGGTATTCATTGAGCCGCGTGAATCAGACGAGGCAAACGAAGCGCTGA AGGAGTTCATCTCGCTCCCGGGAAAACATAAATCCGGGATACTTTTCGCCGTCTGCGGCGGGAAATGGAGCGAAGGTCTG GATTACCGGGGCGATCAACTGACCGCGGCCCTCGTGATAGGTCTCCCGCTCGCTCCGTTCACCCCCGTTCGTCGGATGGT CAACAGTTATTACCGGCGCAAGTTTGGGGCCGAAGGAGAGTTCATCGCCTACACGCTTCCTGCGATCAACAAATCTATGC AGGCCCTCGGTCGTGTCCTTCGAACCGAAAACGACCGGGGTGTTTTGATTCTCGGCGACCAAAGATTCCTTGAAGGCGAG ATTTTCGGCGGTTTATCTCCCTGGATGCAGGATGAACTTATGGAATGCGATGTGGACACGGTAAAAAGTAAGCTTGAAAA GTGGGGACGTGATGCGTCAGGGCGCCTGTAG
Upstream 100 bases:
>100_bases ATACCTCCACCTTTGCGAGAAGTGCGAGTATCTGATCTTTGGTCTGGGTCGAAAGAGGCATGCTTAATAGATTTGGGTCC AGACAAATAATACATTACGA
Downstream 100 bases:
>100_bases TTTCGGACTCTGGAAGGTCGCTGTCGATTATGACGATATGGTAGTCCACCGGGTCAGGTTCATGAGAACGGCACCGGACG GGCCGGTTCCGATAGAGTTC
Product: queuine tRNA-ribosyltransferase
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 676; Mature: 675
Protein sequence:
>676_residues MADTADFFPYQTYRKNQKEMLEEVEKTAEENGILLIDAPTGSGKSSVIASLLAKANGRKILVAVRTISQLQIFIRELDLI RQKKQPTLKFVYLIGKGNMCPLGGYGDVYRRCEGVKAFTSALMQQRADRGSFDPATDKQILEQIRKQDREHPLICPYFVN SRVFVQSEEGGRRMIPSPELRRKSDIAQKQIVRPNELLNFAGKVCPYDLMLSAAKGADVIICNYYHLFNDDIREQLYVNL QCEEHNVMLLLDEAHNLGDVIQTIQSIRIRDTDIEAAANEVASLRDKVRGSEAVRHILPRIAEFIDGLQRSNEAEDWFDP QIFNRFIIKGSLYGKPEAMLEDIISIKEAMRERGIERGDYRESAIEKLCEFLIRLYRSSTDPSFLTVYTKDAETITLEVR NIDPADRLQELVSKHAATILISGTLSPVDSYRKYYFGSMPVKTLSLANSFPKENRLVLGTRDITTAFSKRQNAENTQAIV EYILAFAKLPGNIAVYFPSYQLQNRFAEACVSKIRNKQVFIEPRESDEANEALKEFISLPGKHKSGILFAVCGGKWSEGL DYRGDQLTAALVIGLPLAPFTPVRRMVNSYYRRKFGAEGEFIAYTLPAINKSMQALGRVLRTENDRGVLILGDQRFLEGE IFGGLSPWMQDELMECDVDTVKSKLEKWGRDASGRL
Sequences:
>Translated_676_residues MADTADFFPYQTYRKNQKEMLEEVEKTAEENGILLIDAPTGSGKSSVIASLLAKANGRKILVAVRTISQLQIFIRELDLI RQKKQPTLKFVYLIGKGNMCPLGGYGDVYRRCEGVKAFTSALMQQRADRGSFDPATDKQILEQIRKQDREHPLICPYFVN SRVFVQSEEGGRRMIPSPELRRKSDIAQKQIVRPNELLNFAGKVCPYDLMLSAAKGADVIICNYYHLFNDDIREQLYVNL QCEEHNVMLLLDEAHNLGDVIQTIQSIRIRDTDIEAAANEVASLRDKVRGSEAVRHILPRIAEFIDGLQRSNEAEDWFDP QIFNRFIIKGSLYGKPEAMLEDIISIKEAMRERGIERGDYRESAIEKLCEFLIRLYRSSTDPSFLTVYTKDAETITLEVR NIDPADRLQELVSKHAATILISGTLSPVDSYRKYYFGSMPVKTLSLANSFPKENRLVLGTRDITTAFSKRQNAENTQAIV EYILAFAKLPGNIAVYFPSYQLQNRFAEACVSKIRNKQVFIEPRESDEANEALKEFISLPGKHKSGILFAVCGGKWSEGL DYRGDQLTAALVIGLPLAPFTPVRRMVNSYYRRKFGAEGEFIAYTLPAINKSMQALGRVLRTENDRGVLILGDQRFLEGE IFGGLSPWMQDELMECDVDTVKSKLEKWGRDASGRL >Mature_675_residues ADTADFFPYQTYRKNQKEMLEEVEKTAEENGILLIDAPTGSGKSSVIASLLAKANGRKILVAVRTISQLQIFIRELDLIR QKKQPTLKFVYLIGKGNMCPLGGYGDVYRRCEGVKAFTSALMQQRADRGSFDPATDKQILEQIRKQDREHPLICPYFVNS RVFVQSEEGGRRMIPSPELRRKSDIAQKQIVRPNELLNFAGKVCPYDLMLSAAKGADVIICNYYHLFNDDIREQLYVNLQ CEEHNVMLLLDEAHNLGDVIQTIQSIRIRDTDIEAAANEVASLRDKVRGSEAVRHILPRIAEFIDGLQRSNEAEDWFDPQ IFNRFIIKGSLYGKPEAMLEDIISIKEAMRERGIERGDYRESAIEKLCEFLIRLYRSSTDPSFLTVYTKDAETITLEVRN IDPADRLQELVSKHAATILISGTLSPVDSYRKYYFGSMPVKTLSLANSFPKENRLVLGTRDITTAFSKRQNAENTQAIVE YILAFAKLPGNIAVYFPSYQLQNRFAEACVSKIRNKQVFIEPRESDEANEALKEFISLPGKHKSGILFAVCGGKWSEGLD YRGDQLTAALVIGLPLAPFTPVRRMVNSYYRRKFGAEGEFIAYTLPAINKSMQALGRVLRTENDRGVLILGDQRFLEGEI FGGLSPWMQDELMECDVDTVKSKLEKWGRDASGRL
Specific function: Unknown
COG id: COG1199
COG function: function code KL; Rad3-related DNA helicases
Gene ontology:
Cell location: Cytoplasmic
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 1 helicase C-terminal domain [H]
Homologues:
Organism=Homo sapiens, GI301897118, Length=542, Percent_Identity=24.169741697417, Blast_Score=114, Evalue=4e-25, Organism=Homo sapiens, GI15834617, Length=757, Percent_Identity=22.5891677675033, Blast_Score=112, Evalue=9e-25, Organism=Homo sapiens, GI91984775, Length=547, Percent_Identity=22.4862888482633, Blast_Score=85, Evalue=2e-16, Organism=Homo sapiens, GI7706541, Length=547, Percent_Identity=22.4862888482633, Blast_Score=85, Evalue=2e-16, Organism=Caenorhabditis elegans, GI71994598, Length=520, Percent_Identity=23.0769230769231, Blast_Score=110, Evalue=2e-24, Organism=Caenorhabditis elegans, GI17554258, Length=282, Percent_Identity=28.0141843971631, Blast_Score=87, Evalue=4e-17, Organism=Caenorhabditis elegans, GI17506821, Length=575, Percent_Identity=21.7391304347826, Blast_Score=72, Evalue=1e-12, Organism=Caenorhabditis elegans, GI17507137, Length=294, Percent_Identity=25.1700680272109, Blast_Score=72, Evalue=1e-12, Organism=Saccharomyces cerevisiae, GI6325249, Length=508, Percent_Identity=22.8346456692913, Blast_Score=99, Evalue=2e-21, Organism=Saccharomyces cerevisiae, GI6321019, Length=280, Percent_Identity=26.0714285714286, Blast_Score=86, Evalue=2e-17, Organism=Drosophila melanogaster, GI45551134, Length=743, Percent_Identity=22.6110363391655, Blast_Score=124, Evalue=2e-28, Organism=Drosophila melanogaster, GI281363902, Length=727, Percent_Identity=22.5584594222834, Blast_Score=116, Evalue=5e-26, Organism=Drosophila melanogaster, GI17137232, Length=727, Percent_Identity=22.5584594222834, Blast_Score=116, Evalue=5e-26, Organism=Drosophila melanogaster, GI24639946, Length=271, Percent_Identity=26.9372693726937, Blast_Score=97, Evalue=3e-20, Organism=Drosophila melanogaster, GI18543219, Length=315, Percent_Identity=24.7619047619048, Blast_Score=75, Evalue=2e-13,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR010614 - InterPro: IPR014013 - InterPro: IPR006555 - InterPro: IPR001650 [H]
Pfam domain/function: PF06733 DEAD_2 [H]
EC number: =3.6.4.12 [H]
Molecular weight: Translated: 76618; Mature: 76487
Theoretical pI: Translated: 7.39; Mature: 7.39
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.5 %Cys (Translated Protein) 2.1 %Met (Translated Protein) 3.6 %Cys+Met (Translated Protein) 1.5 %Cys (Mature Protein) 1.9 %Met (Mature Protein) 3.4 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MADTADFFPYQTYRKNQKEMLEEVEKTAEENGILLIDAPTGSGKSSVIASLLAKANGRKI CCCCCCCCCCHHHHCCHHHHHHHHHHHHHHCCEEEEECCCCCCHHHHHHHHHHCCCCCEE LVAVRTISQLQIFIRELDLIRQKKQPTLKFVYLIGKGNMCPLGGYGDVYRRCEGVKAFTS EEEHHHHHHHHHHHHHHHHHHHCCCCCEEEEEEEECCCCCCCCCCHHHHHHHCCHHHHHH ALMQQRADRGSFDPATDKQILEQIRKQDREHPLICPYFVNSRVFVQSEEGGRRMIPSPEL HHHHHHHCCCCCCCCCHHHHHHHHHHCCCCCCEEEEEEECCEEEEEECCCCCCCCCCCHH RRKSDIAQKQIVRPNELLNFAGKVCPYDLMLSAAKGADVIICNYYHLFNDDIREQLYVNL HHHHHHHHHHCCCHHHHHHHHCCCCCHHHHHHHCCCCCEEEEEEHHHHCHHHHHHEEEEE QCEEHNVMLLLDEAHNLGDVIQTIQSIRIRDTDIEAAANEVASLRDKVRGSEAVRHILPR EECCCCEEEEECCCCCHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHCHHHHHHHHHHH IAEFIDGLQRSNEAEDWFDPQIFNRFIIKGSLYGKPEAMLEDIISIKEAMRERGIERGDY HHHHHHHHHCCCCCCCCCCHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHCCCCCCCH RESAIEKLCEFLIRLYRSSTDPSFLTVYTKDAETITLEVRNIDPADRLQELVSKHAATIL HHHHHHHHHHHHHHHHHCCCCCCEEEEEECCCCEEEEEEECCCHHHHHHHHHHHCCEEEE ISGTLSPVDSYRKYYFGSMPVKTLSLANSFPKENRLVLGTRDITTAFSKRQNAENTQAIV EECCCCHHHHHHHHHCCCCCHHHHHHHHCCCCCCEEEEECHHHHHHHHHHCCCCHHHHHH EYILAFAKLPGNIAVYFPSYQLQNRFAEACVSKIRNKQVFIEPRESDEANEALKEFISLP HHHHHHHHCCCCEEEEECCHHHHHHHHHHHHHHHCCCEEEECCCCCCHHHHHHHHHHCCC GKHKSGILFAVCGGKWSEGLDYRGDQLTAALVIGLPLAPFTPVRRMVNSYYRRKFGAEGE CCCCCCEEEEEECCCCCCCCCCCCCHHHHHHEECCCCCCCHHHHHHHHHHHHHHCCCCCC FIAYTLPAINKSMQALGRVLRTENDRGVLILGDQRFLEGEIFGGLSPWMQDELMECDVDT EEEEECHHHHHHHHHHHHHHHCCCCCEEEEECCCCEECCHHCCCCCHHHHHHHHHCCHHH VKSKLEKWGRDASGRL HHHHHHHHCCCCCCCC >Mature Secondary Structure ADTADFFPYQTYRKNQKEMLEEVEKTAEENGILLIDAPTGSGKSSVIASLLAKANGRKI CCCCCCCCCHHHHCCHHHHHHHHHHHHHHCCEEEEECCCCCCHHHHHHHHHHCCCCCEE LVAVRTISQLQIFIRELDLIRQKKQPTLKFVYLIGKGNMCPLGGYGDVYRRCEGVKAFTS EEEHHHHHHHHHHHHHHHHHHHCCCCCEEEEEEEECCCCCCCCCCHHHHHHHCCHHHHHH ALMQQRADRGSFDPATDKQILEQIRKQDREHPLICPYFVNSRVFVQSEEGGRRMIPSPEL HHHHHHHCCCCCCCCCHHHHHHHHHHCCCCCCEEEEEEECCEEEEEECCCCCCCCCCCHH RRKSDIAQKQIVRPNELLNFAGKVCPYDLMLSAAKGADVIICNYYHLFNDDIREQLYVNL HHHHHHHHHHCCCHHHHHHHHCCCCCHHHHHHHCCCCCEEEEEEHHHHCHHHHHHEEEEE QCEEHNVMLLLDEAHNLGDVIQTIQSIRIRDTDIEAAANEVASLRDKVRGSEAVRHILPR EECCCCEEEEECCCCCHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHCHHHHHHHHHHH IAEFIDGLQRSNEAEDWFDPQIFNRFIIKGSLYGKPEAMLEDIISIKEAMRERGIERGDY HHHHHHHHHCCCCCCCCCCHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHCCCCCCCH RESAIEKLCEFLIRLYRSSTDPSFLTVYTKDAETITLEVRNIDPADRLQELVSKHAATIL HHHHHHHHHHHHHHHHHCCCCCCEEEEEECCCCEEEEEEECCCHHHHHHHHHHHCCEEEE ISGTLSPVDSYRKYYFGSMPVKTLSLANSFPKENRLVLGTRDITTAFSKRQNAENTQAIV EECCCCHHHHHHHHHCCCCCHHHHHHHHCCCCCCEEEEECHHHHHHHHHHCCCCHHHHHH EYILAFAKLPGNIAVYFPSYQLQNRFAEACVSKIRNKQVFIEPRESDEANEALKEFISLP HHHHHHHHCCCCEEEEECCHHHHHHHHHHHHHHHCCCEEEECCCCCCHHHHHHHHHHCCC GKHKSGILFAVCGGKWSEGLDYRGDQLTAALVIGLPLAPFTPVRRMVNSYYRRKFGAEGE CCCCCCEEEEEECCCCCCCCCCCCCHHHHHHEECCCCCCCHHHHHHHHHHHHHHCCCCCC FIAYTLPAINKSMQALGRVLRTENDRGVLILGDQRFLEGEIFGGLSPWMQDELMECDVDT EEEEECHHHHHHHHHHHHHHHCCCCCEEEEECCCCEECCHHCCCCCHHHHHHHHHCCHHH VKSKLEKWGRDASGRL HHHHHHHHCCCCCCCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 11029001 [H]