| Definition | Halobacterium sp. NRC-1 plasmid pNRC200, complete sequence. |
|---|---|
| Accession | NC_002608 |
| Length | 365,425 |
Click here to switch to the map view.
The map label for this gene is Not Available
Identifier: 16120088
GI number: 16120088
Start: 107069
End: 109054
Strand: Direct
Name: Not Available
Synonym: VNG6136H
Alternate gene names: 16120088
Gene position: 107069-109054 (Clockwise)
Preceding gene: 16120087
Following gene: 16120089
Centisome position: 29.3
GC content: 46.12
Gene sequence:
>1986_bases ATGGCTAAGTCACTGACGAGCGACAGTCAGTGGGAGGATATACAGTCGAAAGATTGGTTCATTGAGGCGCAAGAACTTGC CGAAGAGAAATCCTTCTTCAACTGGCGCTTAGAGTACCCAGACATTTTCTACGACGAAGCTGGGGAAGAGAAAGAGAACC CTGGATTTGACGTTGTTCTCGGAAATCCGCCTTATATCAACGCCATCGAGCTGAACGATATTACTACGCATGAGAAGGAC TTGTGGAAAAAACGATTCAATTCGGCTAAGGACGCTTATGACATCTATGTCCTGTTCTTAGAACAAAGTCTTGAATTATC CCGAACGGACGGCGTTGTTGGACTGATTGTTCCAAACAAACATTTGTCTGCTCCTTACGCGAAGACGTACCGAGAGTACA TCATCGACAACCACCAGATGTGGAAAATATGTGACGTATCCCAGCTTGGTGTATTCGAAGACCCCAGTGTATACCCCGTC ATTCCCTTTTTCAGAACAGAAAGAGACTTCGAAGGTGTTGACAATATTGAGATTGATAAGCCTGTTTCGACGGTTTCAAT CTCAACCGGTAGTGAACAGATGGATGTCTGCGCTCCTAGTAAACTGACCAAAATCGGTAACAACCTCTGGGGGCCTCTAT TGCTTGATCTAGAAGAACAGGATGCTTTCTGGAGCACAGTTGAGGACACTGTCCAGTTAGACAGCGAAGGAACTGTGCAA GCGTCTAGTACGGCAAGTGAAGCAGAGGAATTCACGGTTGCCCTAAGTGAAGAACCTCCTAGTAAGACGAATAAGAAGTT CATCAAAACAGGAGGAATCGACCCCTTCCAATCATTCTGGAATTCAGAAGAAGTCAGGCACCAGGGAGACTACTACACAA AGCCTGTACTAGATATTGACCATCCCATTATCACCGACCTCCGAAGGTCACAATACAATAGTGAAAAATTGGTATTTGCG AAAGTTGCGTCGATCTTGGAGGCGTTCGTTGATACAGATGGGGAATATGCATCTGTAGATACAAATCTGTTCTACGACTC AAATCTTGACATCAGATACTACGGAGCCATTCTCAATAGTAACGTAGTTCTATTCCTATATTCAGGAATGTTTGGTGCTC TGAGGATGAGAGGAGGAGATTTCCAGTTCCAAGCCCCACAGTTGAAGCAAGTCCCTGTACCTTCCATCTCAATTGATACA CCTGACCCAGAACGTGGTAGTCGGGTTTCAACAGCGTTGGATAGCTACAAAGCTTATCTAGAGGGGAGCGCATCGAGACC TAAGCCCGAGAAGGACGATGTAGCGCATGATTTCCTCGCTGAACTCACAGATCGGATAAGCGAGCTTAAACAAGAACGGG AGAGTCTGAATCTCGCCTTGCTGGATTACTTGGGCATCCCGACTGCTGGTATCCCTGAGGATCTCGAAGGAAAATCTCTT CAGGAATTACACATGCCTGCACCTGGGGTCGCTGATACGCTGCTCTCGGAGACAGGTGAAGACCTCGATGGGCTTCGCAT TGAGGGTGTTTCGTTCAGTGGTGACAACTCGAAGCTCGTGATGTCTGTAGATGTTAGCTATAAGCCTGATGATGAGGACG CCCGAGAAACAGACCGGTACGGTCGATTAGCCGAGAATGAATTTGAAACATATGATGCGATGGTATTCACGGGCCTTTCA GATAAAAAGAGGACCCTGATCGAGATTTTCGTCCCAGAGGCAGTTAGTCGAGCAGGTGGATTTGCAGATTTCCGCCAAAG TGCGACAAAGACGATTTCCCCGTTGGAGAGACTTGAAAATCTAGTACTCCCGGATCTTGATGCTATCAAAAACGGCTTAG AGAAATACGAAGACGTCAGACAAGATGCTAACGAACTCGATGAGAAAATCAACAAGACAGATACACTAATCAACGAGATT GTCTATAGCCTGTACGATCTCTCCACTGAAGAGATTGATATTATTGAAACCTCACTAGAGGAATGA
Upstream 100 bases:
>100_bases GTTCGAGGCGAATGTTCTTCGTCAGCGTCTCGAAGCAATTGTTGATGTTTACACCGCCGAGGAGTTTGAGGTTAATGTTC CGAACGGTGCCTACGAGCAG
Downstream 100 bases:
>100_bases CTGACTTTGAGGTCGGCGATCACGTCAAGTTCGCCGGTGGGCGGGGCGAAATCACGAAGATCGAGGACCGCCCAAACGGA GGCCAACTCCTCCATATCTA
Product: hypothetical protein
Products: NA
Alternate protein names: Endonuclease Eco57I; Adenine-specific methyltransferase activity Eco57IA; M.Eco57IA [H]
Number of amino acids: Translated: 661; Mature: 660
Protein sequence:
>661_residues MAKSLTSDSQWEDIQSKDWFIEAQELAEEKSFFNWRLEYPDIFYDEAGEEKENPGFDVVLGNPPYINAIELNDITTHEKD LWKKRFNSAKDAYDIYVLFLEQSLELSRTDGVVGLIVPNKHLSAPYAKTYREYIIDNHQMWKICDVSQLGVFEDPSVYPV IPFFRTERDFEGVDNIEIDKPVSTVSISTGSEQMDVCAPSKLTKIGNNLWGPLLLDLEEQDAFWSTVEDTVQLDSEGTVQ ASSTASEAEEFTVALSEEPPSKTNKKFIKTGGIDPFQSFWNSEEVRHQGDYYTKPVLDIDHPIITDLRRSQYNSEKLVFA KVASILEAFVDTDGEYASVDTNLFYDSNLDIRYYGAILNSNVVLFLYSGMFGALRMRGGDFQFQAPQLKQVPVPSISIDT PDPERGSRVSTALDSYKAYLEGSASRPKPEKDDVAHDFLAELTDRISELKQERESLNLALLDYLGIPTAGIPEDLEGKSL QELHMPAPGVADTLLSETGEDLDGLRIEGVSFSGDNSKLVMSVDVSYKPDDEDARETDRYGRLAENEFETYDAMVFTGLS DKKRTLIEIFVPEAVSRAGGFADFRQSATKTISPLERLENLVLPDLDAIKNGLEKYEDVRQDANELDEKINKTDTLINEI VYSLYDLSTEEIDIIETSLEE
Sequences:
>Translated_661_residues MAKSLTSDSQWEDIQSKDWFIEAQELAEEKSFFNWRLEYPDIFYDEAGEEKENPGFDVVLGNPPYINAIELNDITTHEKD LWKKRFNSAKDAYDIYVLFLEQSLELSRTDGVVGLIVPNKHLSAPYAKTYREYIIDNHQMWKICDVSQLGVFEDPSVYPV IPFFRTERDFEGVDNIEIDKPVSTVSISTGSEQMDVCAPSKLTKIGNNLWGPLLLDLEEQDAFWSTVEDTVQLDSEGTVQ ASSTASEAEEFTVALSEEPPSKTNKKFIKTGGIDPFQSFWNSEEVRHQGDYYTKPVLDIDHPIITDLRRSQYNSEKLVFA KVASILEAFVDTDGEYASVDTNLFYDSNLDIRYYGAILNSNVVLFLYSGMFGALRMRGGDFQFQAPQLKQVPVPSISIDT PDPERGSRVSTALDSYKAYLEGSASRPKPEKDDVAHDFLAELTDRISELKQERESLNLALLDYLGIPTAGIPEDLEGKSL QELHMPAPGVADTLLSETGEDLDGLRIEGVSFSGDNSKLVMSVDVSYKPDDEDARETDRYGRLAENEFETYDAMVFTGLS DKKRTLIEIFVPEAVSRAGGFADFRQSATKTISPLERLENLVLPDLDAIKNGLEKYEDVRQDANELDEKINKTDTLINEI VYSLYDLSTEEIDIIETSLEE >Mature_660_residues AKSLTSDSQWEDIQSKDWFIEAQELAEEKSFFNWRLEYPDIFYDEAGEEKENPGFDVVLGNPPYINAIELNDITTHEKDL WKKRFNSAKDAYDIYVLFLEQSLELSRTDGVVGLIVPNKHLSAPYAKTYREYIIDNHQMWKICDVSQLGVFEDPSVYPVI PFFRTERDFEGVDNIEIDKPVSTVSISTGSEQMDVCAPSKLTKIGNNLWGPLLLDLEEQDAFWSTVEDTVQLDSEGTVQA SSTASEAEEFTVALSEEPPSKTNKKFIKTGGIDPFQSFWNSEEVRHQGDYYTKPVLDIDHPIITDLRRSQYNSEKLVFAK VASILEAFVDTDGEYASVDTNLFYDSNLDIRYYGAILNSNVVLFLYSGMFGALRMRGGDFQFQAPQLKQVPVPSISIDTP DPERGSRVSTALDSYKAYLEGSASRPKPEKDDVAHDFLAELTDRISELKQERESLNLALLDYLGIPTAGIPEDLEGKSLQ ELHMPAPGVADTLLSETGEDLDGLRIEGVSFSGDNSKLVMSVDVSYKPDDEDARETDRYGRLAENEFETYDAMVFTGLSD KKRTLIEIFVPEAVSRAGGFADFRQSATKTISPLERLENLVLPDLDAIKNGLEKYEDVRQDANELDEKINKTDTLINEIV YSLYDLSTEEIDIIETSLEE
Specific function: Recognizes the double-stranded sequences CTGAAG and CTTCAG and cleaves respectively 22 bases after C-1 and 14 bases before C'-1. Also acts as a methylase that causes specific methylation on A-5 on one strand, the other strand being methylated by the Eco57
COG id: COG1002
COG function: function code V; Type II restriction enzyme, methylase subunits
Gene ontology:
Cell location: Cytoplasmic
Metaboloic importance: NA
Operon status: Not Known
Operon components: None
Similarity: NA
Homologues:
None
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR002052 - InterPro: IPR002296 - InterPro: IPR011639 [H]
Pfam domain/function: PF07669 Eco57I [H]
EC number: =3.1.21.4; =2.1.1.72 [H]
Molecular weight: Translated: 74581; Mature: 74450
Theoretical pI: Translated: 4.08; Mature: 4.08
Prosite motif: PS00092 N6_MTASE
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.3 %Cys (Translated Protein) 1.2 %Met (Translated Protein) 1.5 %Cys+Met (Translated Protein) 0.3 %Cys (Mature Protein) 1.1 %Met (Mature Protein) 1.4 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MAKSLTSDSQWEDIQSKDWFIEAQELAEEKSFFNWRLEYPDIFYDEAGEEKENPGFDVVL CCCCCCCCCCHHHCCCCCCEEEHHHHHHHHHHEEEEECCCCCCCCCCCCCCCCCCEEEEE GNPPYINAIELNDITTHEKDLWKKRFNSAKDAYDIYVLFLEQSLELSRTDGVVGLIVPNK CCCCEEEEEECCCCCCCHHHHHHHHHCCCCCCCEEEEEEEECCCCHHCCCCEEEEEECCC HLSAPYAKTYREYIIDNHQMWKICDVSQLGVFEDPSVYPVIPFFRTERDFEGVDNIEIDK CCCCCHHHHHHHHHCCCCCEEEEECHHHCCCCCCCCCCEECCHHCCCCCCCCCCCCEECC PVSTVSISTGSEQMDVCAPSKLTKIGNNLWGPLLLDLEEQDAFWSTVEDTVQLDSEGTVQ CCEEEEECCCCCCHHCCCCHHHHHHHCCCCCCEEEEECCCCHHHHHHHHHHEECCCCCEE ASSTASEAEEFTVALSEEPPSKTNKKFIKTGGIDPFQSFWNSEEVRHQGDYYTKPVLDID ECCCHHHHHHEEEEECCCCCCCCCCHHHHCCCCCHHHHHCCCHHHHHCCCCCCCCCCCCC HPIITDLRRSQYNSEKLVFAKVASILEAFVDTDGEYASVDTNLFYDSNLDIRYYGAILNS CHHHHHHHHHCCCCCHHHHHHHHHHHHHHHCCCCCEEEECCEEEECCCCCEEEEEEECCC NVVLFLYSGMFGALRMRGGDFQFQAPQLKQVPVPSISIDTPDPERGSRVSTALDSYKAYL CEEEEEECCHHHHHEECCCCCEECCCCCCCCCCCEEECCCCCCCCCCHHHHHHHHHHHHH EGSASRPKPEKDDVAHDFLAELTDRISELKQERESLNLALLDYLGIPTAGIPEDLEGKSL CCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEHHHCCCCCCCCCCCCCCCH QELHMPAPGVADTLLSETGEDLDGLRIEGVSFSGDNSKLVMSVDVSYKPDDEDARETDRY HHHCCCCCCHHHHHHHHCCCCCCCEEEEEEEECCCCCEEEEEEECCCCCCCCHHHHHHHH GRLAENEFETYDAMVFTGLSDKKRTLIEIFVPEAVSRAGGFADFRQSATKTISPLERLEN CCHHCCHHHHHHEEEEECCCCCCCEEEEEECCHHHHHCCCHHHHHHHHHHHHHHHHHHHH LVLPDLDAIKNGLEKYEDVRQDANELDEKINKTDTLINEIVYSLYDLSTEEIDIIETSLE HCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHCCC E C >Mature Secondary Structure AKSLTSDSQWEDIQSKDWFIEAQELAEEKSFFNWRLEYPDIFYDEAGEEKENPGFDVVL CCCCCCCCCHHHCCCCCCEEEHHHHHHHHHHEEEEECCCCCCCCCCCCCCCCCCEEEEE GNPPYINAIELNDITTHEKDLWKKRFNSAKDAYDIYVLFLEQSLELSRTDGVVGLIVPNK CCCCEEEEEECCCCCCCHHHHHHHHHCCCCCCCEEEEEEEECCCCHHCCCCEEEEEECCC HLSAPYAKTYREYIIDNHQMWKICDVSQLGVFEDPSVYPVIPFFRTERDFEGVDNIEIDK CCCCCHHHHHHHHHCCCCCEEEEECHHHCCCCCCCCCCEECCHHCCCCCCCCCCCCEECC PVSTVSISTGSEQMDVCAPSKLTKIGNNLWGPLLLDLEEQDAFWSTVEDTVQLDSEGTVQ CCEEEEECCCCCCHHCCCCHHHHHHHCCCCCCEEEEECCCCHHHHHHHHHHEECCCCCEE ASSTASEAEEFTVALSEEPPSKTNKKFIKTGGIDPFQSFWNSEEVRHQGDYYTKPVLDID ECCCHHHHHHEEEEECCCCCCCCCCHHHHCCCCCHHHHHCCCHHHHHCCCCCCCCCCCCC HPIITDLRRSQYNSEKLVFAKVASILEAFVDTDGEYASVDTNLFYDSNLDIRYYGAILNS CHHHHHHHHHCCCCCHHHHHHHHHHHHHHHCCCCCEEEECCEEEECCCCCEEEEEEECCC NVVLFLYSGMFGALRMRGGDFQFQAPQLKQVPVPSISIDTPDPERGSRVSTALDSYKAYL CEEEEEECCHHHHHEECCCCCEECCCCCCCCCCCEEECCCCCCCCCCHHHHHHHHHHHHH EGSASRPKPEKDDVAHDFLAELTDRISELKQERESLNLALLDYLGIPTAGIPEDLEGKSL CCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEHHHCCCCCCCCCCCCCCCH QELHMPAPGVADTLLSETGEDLDGLRIEGVSFSGDNSKLVMSVDVSYKPDDEDARETDRY HHHCCCCCCHHHHHHHHCCCCCCCEEEEEEEECCCCCEEEEEEECCCCCCCCHHHHHHHH GRLAENEFETYDAMVFTGLSDKKRTLIEIFVPEAVSRAGGFADFRQSATKTISPLERLEN CCHHCCHHHHHHEEEEECCCCCCCEEEEEECCHHHHHCCCHHHHHHHHHHHHHHHHHHHH LVLPDLDAIKNGLEKYEDVRQDANELDEKINKTDTLINEIVYSLYDLSTEEIDIIETSLE HCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHCCC E C
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 1334261; 1334260 [H]