| Definition | Bacillus cereus E33L, complete genome. |
|---|---|
| Accession | NC_006274 |
| Length | 5,300,915 |
Click here to switch to the map view.
The map label for this gene is vacB [H]
Identifier: 52140440
GI number: 52140440
Start: 4910465
End: 4912897
Strand: Reverse
Name: vacB [H]
Synonym: BCZK4818
Alternate gene names: 52140440
Gene position: 4912897-4910465 (Counterclockwise)
Preceding gene: 52140439
Following gene: 52140442
Centisome position: 92.68
GC content: 41.14
Gene sequence:
>2433_bases TTGGAAGAAATCATACAAGAACATATTGATAAGTTGTTATTATTTATGAGAGAAGAAGCGTATAAACCGCTAACGATACA AGAGTTAGAAGAGGCATTTGGGATTGAAGGTTCTGAGGGCTTTAAAGATTTCGTAAAGGCACTTGTAACGATGGAAGAAA AGGGACTTGTTATTCGTACTCGTAGCAACCGTTACGGTCTTCCTGAAAAGATGAATTTAGTACGTGGTAAGTTAATTGGA CATGCACGTGGCTTTGCATTCGTTGTACCAGACGAGAAGAAAACAGGAGATGATGATCTTTTCATCCCACCTACAGAATT AAACGGTGCACTTCATGGCGATACAGTATTAGCACGCCTTAGTTCCCAATCGAGTGGTTCGCGTCAAGAAGGTTCCATTG TACGCATTTTAGAGCGTGGCACGAAAGAATTAGTTGGTACATATACAGAATCGAAAAACTTTGGATTTGTTATACCTGAC AATAAACGTTGGACAAGTGACATTTTCGTATTGAAAAGCGCATCAATGGGCGCTGTAGAAGGTCATAAAGTAGTTGTGAA AATTACGAGCTATCCAGAGAATCGTTTAAGTGCAGAAGGTGAAGTTATTCAAATTCTAGGTCATAAAAATGATCCAGGAG TAGATATTTTATCTGTCATTCATAAACATCACTTGCCTTTAGCGTTCCCTGAAGAAGTGATGGAGCACGCAAACAGTGTA CCAGAAACGATTTCAGAAGAAGATTTAAAAGATCGCCGTGACCTACGTGACCAAATGATCGTAACAATTGACGGTGCAGA CGCGAAAGATTTAGATGATGCTGTTACAGTAACGAAGCTCGAGAACGGTAACTATAAGCTTGGCGTTCACATTGCGGATG TAAGCCATTACGTTCAAGAAGGTTCTCCAATTGATGTAGAAGCAGCGGAAAGAGCGACGAGTGTATATCTTGTTGACCGT GTAATTCCAATGATTCCACATCGTCTATCTAACGGTATTTGTTCATTAAATCCGAAAGTAGACCGTCTGACGTTATCTTG TGAAATGGAAATCAACAACTTAGGTGACGTTGTCAAACACGAGATTTTCCAAAGTGTAATTAAAACGACAGAGCGTATGA CGTATGCTGACGTAAGAAGCATTTTAGAAGATGAGGACGAAGAATTAATTAAGCGCTATGAACCGTTAGTACCGATGTTT AAAGAAATGGGCCAATTGGCACAAATTTTACGTGAAAAACGTATGCGCCGCGGTGCAATCGACTTTGACTTTAAAGAAGC GAAAGTATTAGTAGATGAAGAAGGAAAACCGACAGATGTTGTTATGCGTGATCGTTCTGTATCAGAGAAGTTAATTGAAG AATTTATGCTTGTTGCGAACGAAACAGTAGCAGAGCACTTCCACTGGATGAACGTACCATTCATGTATCGTGTCCATGAA GATCCGAAAGAAGATAAGTTAGAGCGTTTCTTCGAGTTTGTAACGAACTTCGGATATGCGGTAAAAGGACGTGCGAATGA AGTGCATCCTCGTGCGCTGCAACAAATTCTTGAAATGGTTCAAGGACAGCCTGAAGAAGTAGTCATTTCAACAGTTATGC TTCGCTCAATGAAGCAAGCACGTTACGATGCAGATAGCTTAGGACATTTCGGTTTATCAACGGAGTTCTACACGCATTTC ACATCACCAATTCGTCGTTATCCAGATACGATTGTTCATAGATTAATTCGTGAATACATCATTAACGGTAAAGTCGACAA TGAAACGCAAGCAAAATGGCGTGAAAAATTACCTGAGATTGCAGAACACTCTTCTAATATGGAACGTCGTGCTGTTGAAG CAGAACGTGAAACAGACGAAATGAAAAAAGCAGAGTACATGGTTGATAAGATCGGCGAAGAGTATGACGGTATGATTAGC TCTGTAACAAACTTCGGTTTATTCGTAGAGCTTCCAAATACAATTGAAGGTCTTGTACATGTTAGCTACTTAACGGATGA TTACTACCGTTATGATGAGCAGCATTTCGCAATGATTGGAGAACGTACAGGTAACGTATTCCGCATTGGTGACGAAATTA CAATTCGCGTTATTAACGTAAACAAAGACGAGCGCGCAATTGACTTTGAAATCGTTGGCATGAAAGGTACGCCTCGTCGT AAGTTCAAAGACCGCCCAGTCGTTATCGAACAGCCAAGAACAGGCAGAAAGAAACGCGGTGGACGTAGCGAGCGTAGTAA TGAGCGCGGCGGAGAACGTGGCACAGGAAGAAAATTTGACCGTGGTGGCAAAGGAAAAGGAAGAGGATCTGCATCCGCAT CCACATCTACGTCCGCTAGCCAGCCAGGGAAAAAAGATGGTAACGGCAAGAAGAAAAAAGCATTCTTCGAAAACGTACCA GGATTCAAGAAGAAAAAGAAAAAGCGTAAGTAA
Upstream 100 bases:
>100_bases ACTGTAAAAATCATAAGGGAAGTATTGAAGTTTCGCTTTATACATCCCCTATCTTTCGGATACACTAAATAATATAAGGT TTTAAAGGAGGTATTTTTGC
Downstream 100 bases:
>100_bases GAAAAGGATGGCTTCGCTTTGATAAAAAGCGAGGCTTTTTCTTTTTTATTGGTGGCTTGAGAGCGAGCTACTTTCGCTTT TTGTTGGAATCCAGCTACAG
Product: ribonuclease R (RNase R)
Products: NA
Alternate protein names: RNase R; VacB protein homolog [H]
Number of amino acids: Translated: 810; Mature: 810
Protein sequence:
>810_residues MEEIIQEHIDKLLLFMREEAYKPLTIQELEEAFGIEGSEGFKDFVKALVTMEEKGLVIRTRSNRYGLPEKMNLVRGKLIG HARGFAFVVPDEKKTGDDDLFIPPTELNGALHGDTVLARLSSQSSGSRQEGSIVRILERGTKELVGTYTESKNFGFVIPD NKRWTSDIFVLKSASMGAVEGHKVVVKITSYPENRLSAEGEVIQILGHKNDPGVDILSVIHKHHLPLAFPEEVMEHANSV PETISEEDLKDRRDLRDQMIVTIDGADAKDLDDAVTVTKLENGNYKLGVHIADVSHYVQEGSPIDVEAAERATSVYLVDR VIPMIPHRLSNGICSLNPKVDRLTLSCEMEINNLGDVVKHEIFQSVIKTTERMTYADVRSILEDEDEELIKRYEPLVPMF KEMGQLAQILREKRMRRGAIDFDFKEAKVLVDEEGKPTDVVMRDRSVSEKLIEEFMLVANETVAEHFHWMNVPFMYRVHE DPKEDKLERFFEFVTNFGYAVKGRANEVHPRALQQILEMVQGQPEEVVISTVMLRSMKQARYDADSLGHFGLSTEFYTHF TSPIRRYPDTIVHRLIREYIINGKVDNETQAKWREKLPEIAEHSSNMERRAVEAERETDEMKKAEYMVDKIGEEYDGMIS SVTNFGLFVELPNTIEGLVHVSYLTDDYYRYDEQHFAMIGERTGNVFRIGDEITIRVINVNKDERAIDFEIVGMKGTPRR KFKDRPVVIEQPRTGRKKRGGRSERSNERGGERGTGRKFDRGGKGKGRGSASASTSTSASQPGKKDGNGKKKKAFFENVP GFKKKKKKRK
Sequences:
>Translated_810_residues MEEIIQEHIDKLLLFMREEAYKPLTIQELEEAFGIEGSEGFKDFVKALVTMEEKGLVIRTRSNRYGLPEKMNLVRGKLIG HARGFAFVVPDEKKTGDDDLFIPPTELNGALHGDTVLARLSSQSSGSRQEGSIVRILERGTKELVGTYTESKNFGFVIPD NKRWTSDIFVLKSASMGAVEGHKVVVKITSYPENRLSAEGEVIQILGHKNDPGVDILSVIHKHHLPLAFPEEVMEHANSV PETISEEDLKDRRDLRDQMIVTIDGADAKDLDDAVTVTKLENGNYKLGVHIADVSHYVQEGSPIDVEAAERATSVYLVDR VIPMIPHRLSNGICSLNPKVDRLTLSCEMEINNLGDVVKHEIFQSVIKTTERMTYADVRSILEDEDEELIKRYEPLVPMF KEMGQLAQILREKRMRRGAIDFDFKEAKVLVDEEGKPTDVVMRDRSVSEKLIEEFMLVANETVAEHFHWMNVPFMYRVHE DPKEDKLERFFEFVTNFGYAVKGRANEVHPRALQQILEMVQGQPEEVVISTVMLRSMKQARYDADSLGHFGLSTEFYTHF TSPIRRYPDTIVHRLIREYIINGKVDNETQAKWREKLPEIAEHSSNMERRAVEAERETDEMKKAEYMVDKIGEEYDGMIS SVTNFGLFVELPNTIEGLVHVSYLTDDYYRYDEQHFAMIGERTGNVFRIGDEITIRVINVNKDERAIDFEIVGMKGTPRR KFKDRPVVIEQPRTGRKKRGGRSERSNERGGERGTGRKFDRGGKGKGRGSASASTSTSASQPGKKDGNGKKKKAFFENVP GFKKKKKKRK >Mature_810_residues MEEIIQEHIDKLLLFMREEAYKPLTIQELEEAFGIEGSEGFKDFVKALVTMEEKGLVIRTRSNRYGLPEKMNLVRGKLIG HARGFAFVVPDEKKTGDDDLFIPPTELNGALHGDTVLARLSSQSSGSRQEGSIVRILERGTKELVGTYTESKNFGFVIPD NKRWTSDIFVLKSASMGAVEGHKVVVKITSYPENRLSAEGEVIQILGHKNDPGVDILSVIHKHHLPLAFPEEVMEHANSV PETISEEDLKDRRDLRDQMIVTIDGADAKDLDDAVTVTKLENGNYKLGVHIADVSHYVQEGSPIDVEAAERATSVYLVDR VIPMIPHRLSNGICSLNPKVDRLTLSCEMEINNLGDVVKHEIFQSVIKTTERMTYADVRSILEDEDEELIKRYEPLVPMF KEMGQLAQILREKRMRRGAIDFDFKEAKVLVDEEGKPTDVVMRDRSVSEKLIEEFMLVANETVAEHFHWMNVPFMYRVHE DPKEDKLERFFEFVTNFGYAVKGRANEVHPRALQQILEMVQGQPEEVVISTVMLRSMKQARYDADSLGHFGLSTEFYTHF TSPIRRYPDTIVHRLIREYIINGKVDNETQAKWREKLPEIAEHSSNMERRAVEAERETDEMKKAEYMVDKIGEEYDGMIS SVTNFGLFVELPNTIEGLVHVSYLTDDYYRYDEQHFAMIGERTGNVFRIGDEITIRVINVNKDERAIDFEIVGMKGTPRR KFKDRPVVIEQPRTGRKKRGGRSERSNERGGERGTGRKFDRGGKGKGRGSASASTSTSASQPGKKDGNGKKKKAFFENVP GFKKKKKKRK
Specific function: 3'-5'exoribonuclease that participates in an essential cell function. Acts nonspecifically on poly(A), poly(U) and ribosomal RNAs [H]
COG id: COG0557
COG function: function code K; Exoribonuclease R
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 1 S1 motif domain [H]
Homologues:
Organism=Homo sapiens, GI190014623, Length=462, Percent_Identity=30.952380952381, Blast_Score=227, Evalue=4e-59, Organism=Homo sapiens, GI190014625, Length=462, Percent_Identity=30.952380952381, Blast_Score=227, Evalue=4e-59, Organism=Homo sapiens, GI134288890, Length=414, Percent_Identity=34.0579710144928, Blast_Score=218, Evalue=2e-56, Organism=Homo sapiens, GI19115966, Length=575, Percent_Identity=28, Blast_Score=191, Evalue=2e-48, Organism=Homo sapiens, GI219521928, Length=575, Percent_Identity=28, Blast_Score=191, Evalue=3e-48, Organism=Escherichia coli, GI87082383, Length=725, Percent_Identity=38.7586206896552, Blast_Score=516, Evalue=1e-147, Organism=Escherichia coli, GI1787542, Length=639, Percent_Identity=24.8826291079812, Blast_Score=148, Evalue=2e-36, Organism=Caenorhabditis elegans, GI17553506, Length=538, Percent_Identity=30.1115241635688, Blast_Score=205, Evalue=8e-53, Organism=Caenorhabditis elegans, GI212645896, Length=492, Percent_Identity=28.6585365853659, Blast_Score=189, Evalue=5e-48, Organism=Saccharomyces cerevisiae, GI6324552, Length=589, Percent_Identity=28.0135823429542, Blast_Score=206, Evalue=1e-53, Organism=Saccharomyces cerevisiae, GI6320499, Length=422, Percent_Identity=25.5924170616114, Blast_Score=107, Evalue=9e-24, Organism=Saccharomyces cerevisiae, GI6323943, Length=432, Percent_Identity=22.9166666666667, Blast_Score=86, Evalue=2e-17, Organism=Drosophila melanogaster, GI24649634, Length=475, Percent_Identity=31.1578947368421, Blast_Score=235, Evalue=8e-62, Organism=Drosophila melanogaster, GI19922976, Length=363, Percent_Identity=32.5068870523416, Blast_Score=184, Evalue=2e-46, Organism=Drosophila melanogaster, GI24654597, Length=363, Percent_Identity=32.5068870523416, Blast_Score=184, Evalue=2e-46, Organism=Drosophila melanogaster, GI24654592, Length=363, Percent_Identity=32.5068870523416, Blast_Score=184, Evalue=3e-46,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR011129 - InterPro: IPR012340 - InterPro: IPR016027 - InterPro: IPR003029 - InterPro: IPR022967 - InterPro: IPR013223 - InterPro: IPR001900 - InterPro: IPR022966 - InterPro: IPR004476 - InterPro: IPR011805 [H]
Pfam domain/function: PF08206 OB_RNB; PF00773 RNB; PF00575 S1 [H]
EC number: 3.1.-.- [C]
Molecular weight: Translated: 92251; Mature: 92251
Theoretical pI: Translated: 6.43; Mature: 6.43
Prosite motif: PS50126 S1 ; PS01175 RIBONUCLEASE_II ; PS00189 LIPOYL
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.2 %Cys (Translated Protein) 3.2 %Met (Translated Protein) 3.5 %Cys+Met (Translated Protein) 0.2 %Cys (Mature Protein) 3.2 %Met (Mature Protein) 3.5 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MEEIIQEHIDKLLLFMREEAYKPLTIQELEEAFGIEGSEGFKDFVKALVTMEEKGLVIRT CHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHCCCCCCCHHHHHHHHHHHHCCCEEEEE RSNRYGLPEKMNLVRGKLIGHARGFAFVVPDEKKTGDDDLFIPPTELNGALHGDTVLARL CCCCCCCCHHHHHHHHHHHHCCCCEEEEECCCCCCCCCCEEECCHHCCCCCCHHHHHHHH SSQSSGSRQEGSIVRILERGTKELVGTYTESKNFGFVIPDNKRWTSDIFVLKSASMGAVE HCCCCCCCCCCHHHHHHHHHHHHHHHHHCCCCCCEEEECCCCCCCCEEEEEECCCCCCCC GHKVVVKITSYPENRLSAEGEVIQILGHKNDPGVDILSVIHKHHLPLAFPEEVMEHANSV CCEEEEEEECCCCHHCCCCCCEEEEECCCCCCCHHHHHHHHHHCCCCCCHHHHHHHHCCC PETISEEDLKDRRDLRDQMIVTIDGADAKDLDDAVTVTKLENGNYKLGVHIADVSHYVQE CHHCCHHHHHHHHHHHHCEEEEECCCCCCCCCCCEEEEEEECCCEEEEEEEHHHHHHHHC GSPIDVEAAERATSVYLVDRVIPMIPHRLSNGICSLNPKVDRLTLSCEMEINNLGDVVKH CCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCEEECCCCCEEEEEEEEEEHHHHHHHHHH EIFQSVIKTTERMTYADVRSILEDEDEELIKRYEPLVPMFKEMGQLAQILREKRMRRGAI HHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHCCCC DFDFKEAKVLVDEEGKPTDVVMRDRSVSEKLIEEFMLVANETVAEHFHWMNVPFMYRVHE CCCCCCCEEEECCCCCCCEEEECCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEEECC DPKEDKLERFFEFVTNFGYAVKGRANEVHPRALQQILEMVQGQPEEVVISTVMLRSMKQA CCCHHHHHHHHHHHHCCCCEEECCCCCCCHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHH RYDADSLGHFGLSTEFYTHFTSPIRRYPDTIVHRLIREYIINGKVDNETQAKWREKLPEI HCCHHHCCCCCCCHHHHHHHHHHHHHCHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHH AEHSSNMERRAVEAERETDEMKKAEYMVDKIGEEYDGMISSVTNFGLFVELPNTIEGLVH HHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHCHHHHHHHHHHHHCCEEEECCHHHHHHEE VSYLTDDYYRYDEQHFAMIGERTGNVFRIGDEITIRVINVNKDERAIDFEIVGMKGTPRR EHHHHHHHHHHCCHHHHHHHCCCCCEEEECCEEEEEEEECCCCCCEEEEEEEECCCCCCC KFKDRPVVIEQPRTGRKKRGGRSERSNERGGERGTGRKFDRGGKGKGRGSASASTSTSAS CCCCCCEEEECCCCCCHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC QPGKKDGNGKKKKAFFENVPGFKKKKKKRK CCCCCCCCCCHHHHHHHCCCCHHHHHHCCC >Mature Secondary Structure MEEIIQEHIDKLLLFMREEAYKPLTIQELEEAFGIEGSEGFKDFVKALVTMEEKGLVIRT CHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHCCCCCCCHHHHHHHHHHHHCCCEEEEE RSNRYGLPEKMNLVRGKLIGHARGFAFVVPDEKKTGDDDLFIPPTELNGALHGDTVLARL CCCCCCCCHHHHHHHHHHHHCCCCEEEEECCCCCCCCCCEEECCHHCCCCCCHHHHHHHH SSQSSGSRQEGSIVRILERGTKELVGTYTESKNFGFVIPDNKRWTSDIFVLKSASMGAVE HCCCCCCCCCCHHHHHHHHHHHHHHHHHCCCCCCEEEECCCCCCCCEEEEEECCCCCCCC GHKVVVKITSYPENRLSAEGEVIQILGHKNDPGVDILSVIHKHHLPLAFPEEVMEHANSV CCEEEEEEECCCCHHCCCCCCEEEEECCCCCCCHHHHHHHHHHCCCCCCHHHHHHHHCCC PETISEEDLKDRRDLRDQMIVTIDGADAKDLDDAVTVTKLENGNYKLGVHIADVSHYVQE CHHCCHHHHHHHHHHHHCEEEEECCCCCCCCCCCEEEEEEECCCEEEEEEEHHHHHHHHC GSPIDVEAAERATSVYLVDRVIPMIPHRLSNGICSLNPKVDRLTLSCEMEINNLGDVVKH CCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCEEECCCCCEEEEEEEEEEHHHHHHHHHH EIFQSVIKTTERMTYADVRSILEDEDEELIKRYEPLVPMFKEMGQLAQILREKRMRRGAI HHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHCCCC DFDFKEAKVLVDEEGKPTDVVMRDRSVSEKLIEEFMLVANETVAEHFHWMNVPFMYRVHE CCCCCCCEEEECCCCCCCEEEECCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEEECC DPKEDKLERFFEFVTNFGYAVKGRANEVHPRALQQILEMVQGQPEEVVISTVMLRSMKQA CCCHHHHHHHHHHHHCCCCEEECCCCCCCHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHH RYDADSLGHFGLSTEFYTHFTSPIRRYPDTIVHRLIREYIINGKVDNETQAKWREKLPEI HCCHHHCCCCCCCHHHHHHHHHHHHHCHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHH AEHSSNMERRAVEAERETDEMKKAEYMVDKIGEEYDGMISSVTNFGLFVELPNTIEGLVH HHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHCHHHHHHHHHHHHCCEEEECCHHHHHHEE VSYLTDDYYRYDEQHFAMIGERTGNVFRIGDEITIRVINVNKDERAIDFEIVGMKGTPRR EHHHHHHHHHHCCHHHHHHHCCCCCEEEECCEEEEEEEECCCCCCEEEEEEEECCCCCCC KFKDRPVVIEQPRTGRKKRGGRSERSNERGGERGTGRKFDRGGKGKGRGSASASTSTSAS CCCCCCEEEECCCCCCHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC QPGKKDGNGKKKKAFFENVPGFKKKKKKRK CCCCCCCCCCHHHHHHHCCCCHHHHHHCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: DNA [C]
Specific reaction: Protein + DNA = Protein-DNA [C]
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 9384377 [H]