| Definition | Chlorobium phaeobacteroides DSM 266 chromosome, complete genome. |
|---|---|
| Accession | NC_008639 |
| Length | 3,133,902 |
Click here to switch to the map view.
The map label for this gene is salIM [H]
Identifier: 119357303
GI number: 119357303
Start: 1702470
End: 1704038
Strand: Reverse
Name: salIM [H]
Synonym: Cpha266_1501
Alternate gene names: 119357303
Gene position: 1704038-1702470 (Counterclockwise)
Preceding gene: 119357304
Following gene: 119357302
Centisome position: 54.37
GC content: 53.35
Gene sequence:
>1569_bases ATGACGGTTTTACAGGATACATTCGAGGCGAACCGCCTCAGGCTGCAAAGCGAACTCGACGCCGGAAAGACTCAGGCTGA ACGCAACCGTCTCGGCCAGTTCGCGACGCCGACAGCCCTTGCTCTCGATATCCTTACCTATGCGTCAACGCTGATTCCTG AAGATGAACCTGTCCGTTTTCTCGATCCTGCAGTAGGGACAGGCTCATTCTTTTCAGCATTCCGGCAGGTTTTTCCGGCA GGGCGTATCGATTCCGCACTTGGTTTTGAAGTCGATACCCATTATGGTGAACCGGCCACCCATATCTGGCGGGATACAGG TTTCACGATCAGGCTTGCCGATTTTACGGCAAGCGAACCTTCAGTGCCTTTCAATCTGGTGATCTGCAATCCCCCGTATG TGCGGCACCACCACCTGCAGAATGGCGACAAACTGCGTCTTCAGGCGAAAACCGCCTGTGCAAGCGGCATGAAGATCAGC GGTCTTGCCGGGTTGTACTGCCATTTTCTTGGTTTGTCGCACTCATGGATGGCTGAAGGTGGCATCGCGGGCTGGCTCAT TCCGAGCGAGTTCATGGATGTGAATTACGGCAAGGCCATCAAGCGGTACCTGCTCGAAAAGGTCACGCTGCTGAAAATCC ATCGCTTCGATCCTGACGATGTGCAGTTTGCCGATGCACTTGTCTCTTCCGCTGTCGTCTGGTTCCGCAAAGCACCGCCT CCGGAAAACCACCAGGTCTCGTTTACCTTTGGCGGTTCGTTGCTTGAACCTCGCTGCAGCAGGGATGTTTTGGCGGAGGA TCTTGCCCGAGAGGCTAAATGGACACGGTTTCCCAAGGCAACCGGTATCGGAACAAAAGAAGCGAGAGCGCTCATAGCCG ACTTCTTCCATATCCGGCGGGGTATAGCTACCGGCGACAACGCTTTTTTCATTCTTGACAGAAAGGAGATTGTTGCAAAA AACCTTCCGATGGAGCTGTTCCGGCCCATTCTGCCGAGCCCGCGCTATCTCGTCGAAAATGAGATACTTGCCGCTGCGGA TGGTTACCCCCTGCTTGACCGGCAGCTCTTTCTGCTCGACACAAAGCTTCCTGAAGAGACGATCAAAGAAAGGTATCCGG CGCTCTACGCATATCTTGAAGAAGGAAAGGCAGTTGGTGTTCACGAACGCTATCTGTGCCGCAACCGTACTCCCTGGTAT TCTCAGGAAAACCGGCCTTCTGCTCCTATTGTGTGCACGTACCTTGGCCGCAGCAACACGAAAAGCGGGCGACCTTTCCG CTTTATTCTGAACAATTCGATGGCTACGGTAGCGAACGTCTACCTTGCACTGTATCCAAAACCGCAGCTTGCAAAAGCTG TCTCTCAGAACCCCTCGTTGATTCGTTCAGTATGGGAAGTTCTGAACCGGATTACTCCCGAGCAGCTTCTCGGTGAAAGC CGGGTTTACGGAGGAGGTCTTCACAAACTCGAGCCGAACGAGCTTGCCAATGTCGATGCATCGCAGATAGCCGAACTGAT TCCTGATTTCAAGATGGAATCGGGAGTGGAGCAGTTGGGATTGTTTTAG
Upstream 100 bases:
>100_bases GTTATTTCGACAGCGGTTATCTTGGATATGAGGCCGCAGAAGGCATCGACTGGGTCTGGGAACATCGCATCGACGACATG GCGCTTTTCGGGATATGAGC
Downstream 100 bases:
>100_bases AAAGGAAAATAATGTGCGCCCTCCGAGGCGTCCGTATTCTCGCAGGCCAGCACGAACTCACCTTCACCTATGACCGCTCC GATTTCAACAAGGGCAGGTA
Product: hypothetical protein
Products: NA
Alternate protein names: M.SalI; Adenine-specific methyltransferase SalI [H]
Number of amino acids: Translated: 522; Mature: 521
Protein sequence:
>522_residues MTVLQDTFEANRLRLQSELDAGKTQAERNRLGQFATPTALALDILTYASTLIPEDEPVRFLDPAVGTGSFFSAFRQVFPA GRIDSALGFEVDTHYGEPATHIWRDTGFTIRLADFTASEPSVPFNLVICNPPYVRHHHLQNGDKLRLQAKTACASGMKIS GLAGLYCHFLGLSHSWMAEGGIAGWLIPSEFMDVNYGKAIKRYLLEKVTLLKIHRFDPDDVQFADALVSSAVVWFRKAPP PENHQVSFTFGGSLLEPRCSRDVLAEDLAREAKWTRFPKATGIGTKEARALIADFFHIRRGIATGDNAFFILDRKEIVAK NLPMELFRPILPSPRYLVENEILAAADGYPLLDRQLFLLDTKLPEETIKERYPALYAYLEEGKAVGVHERYLCRNRTPWY SQENRPSAPIVCTYLGRSNTKSGRPFRFILNNSMATVANVYLALYPKPQLAKAVSQNPSLIRSVWEVLNRITPEQLLGES RVYGGGLHKLEPNELANVDASQIAELIPDFKMESGVEQLGLF
Sequences:
>Translated_522_residues MTVLQDTFEANRLRLQSELDAGKTQAERNRLGQFATPTALALDILTYASTLIPEDEPVRFLDPAVGTGSFFSAFRQVFPA GRIDSALGFEVDTHYGEPATHIWRDTGFTIRLADFTASEPSVPFNLVICNPPYVRHHHLQNGDKLRLQAKTACASGMKIS GLAGLYCHFLGLSHSWMAEGGIAGWLIPSEFMDVNYGKAIKRYLLEKVTLLKIHRFDPDDVQFADALVSSAVVWFRKAPP PENHQVSFTFGGSLLEPRCSRDVLAEDLAREAKWTRFPKATGIGTKEARALIADFFHIRRGIATGDNAFFILDRKEIVAK NLPMELFRPILPSPRYLVENEILAAADGYPLLDRQLFLLDTKLPEETIKERYPALYAYLEEGKAVGVHERYLCRNRTPWY SQENRPSAPIVCTYLGRSNTKSGRPFRFILNNSMATVANVYLALYPKPQLAKAVSQNPSLIRSVWEVLNRITPEQLLGES RVYGGGLHKLEPNELANVDASQIAELIPDFKMESGVEQLGLF >Mature_521_residues TVLQDTFEANRLRLQSELDAGKTQAERNRLGQFATPTALALDILTYASTLIPEDEPVRFLDPAVGTGSFFSAFRQVFPAG RIDSALGFEVDTHYGEPATHIWRDTGFTIRLADFTASEPSVPFNLVICNPPYVRHHHLQNGDKLRLQAKTACASGMKISG LAGLYCHFLGLSHSWMAEGGIAGWLIPSEFMDVNYGKAIKRYLLEKVTLLKIHRFDPDDVQFADALVSSAVVWFRKAPPP ENHQVSFTFGGSLLEPRCSRDVLAEDLAREAKWTRFPKATGIGTKEARALIADFFHIRRGIATGDNAFFILDRKEIVAKN LPMELFRPILPSPRYLVENEILAAADGYPLLDRQLFLLDTKLPEETIKERYPALYAYLEEGKAVGVHERYLCRNRTPWYS QENRPSAPIVCTYLGRSNTKSGRPFRFILNNSMATVANVYLALYPKPQLAKAVSQNPSLIRSVWEVLNRITPEQLLGESR VYGGGLHKLEPNELANVDASQIAELIPDFKMESGVEQLGLF
Specific function: This methylase recognizes the double-stranded sequence GTCGAC, causes specific methylation on A-5 on both strands, and protects the DNA from cleavage by the SalI endonuclease [H]
COG id: COG0827
COG function: function code L; Adenine-specific DNA methylase
Gene ontology:
Cell location: Cytoplasmic
Metaboloic importance: NA
Operon status: Not Known
Operon components: None
Similarity: Belongs to the N(4)/N(6)-methyltransferase family [H]
Homologues:
None
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR002052 - InterPro: IPR002296 - InterPro: IPR011639 [H]
Pfam domain/function: PF07669 Eco57I [H]
EC number: =2.1.1.72 [H]
Molecular weight: Translated: 58489; Mature: 58357
Theoretical pI: Translated: 7.14; Mature: 7.14
Prosite motif: PS00092 N6_MTASE
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.1 %Cys (Translated Protein) 1.3 %Met (Translated Protein) 2.5 %Cys+Met (Translated Protein) 1.2 %Cys (Mature Protein) 1.2 %Met (Mature Protein) 2.3 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MTVLQDTFEANRLRLQSELDAGKTQAERNRLGQFATPTALALDILTYASTLIPEDEPVRF CCCCHHHHHHHHHHHHHHHCCCHHHHHHHHCCCCCCHHHHHHHHHHHHHHHCCCCCCCCE LDPAVGTGSFFSAFRQVFPAGRIDSALGFEVDTHYGEPATHIWRDTGFTIRLADFTASEP ECCCCCCCHHHHHHHHHCCCCCCCCCCCCEEECCCCCCHHHHCCCCCCEEEEEECCCCCC SVPFNLVICNPPYVRHHHLQNGDKLRLQAKTACASGMKISGLAGLYCHFLGLSHSWMAEG CCCEEEEEECCCCHHHHCCCCCCEEEEEEHHHHHCCCEECHHHHHHHHHHCCCCCHHHCC GIAGWLIPSEFMDVNYGKAIKRYLLEKVTLLKIHRFDPDDVQFADALVSSAVVWFRKAPP CEEEEECCHHHHCCCHHHHHHHHHHHHHHHHEEECCCCCHHHHHHHHHHHHHHHHCCCCC PENHQVSFTFGGSLLEPRCSRDVLAEDLAREAKWTRFPKATGIGTKEARALIADFFHIRR CCCCEEEEEECCCCCCCCCCHHHHHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHH GIATGDNAFFILDRKEIVAKNLPMELFRPILPSPRYLVENEILAAADGYPLLDRQLFLLD CCCCCCCEEEEEECHHHHHHCCCHHHHHHCCCCCCEECCCCEEEECCCCCCCCCEEEEEE TKLPEETIKERYPALYAYLEEGKAVGVHERYLCRNRTPWYSQENRPSAPIVCTYLGRSNT CCCCHHHHHHHHHHHHHHHHCCCCCCCHHHHHHCCCCCCCCCCCCCCCCEEEEECCCCCC KSGRPFRFILNNSMATVANVYLALYPKPQLAKAVSQNPSLIRSVWEVLNRITPEQLLGES CCCCCEEEEECCCHHHHHHHHHEECCCHHHHHHHCCCHHHHHHHHHHHHCCCHHHHHCCC RVYGGGLHKLEPNELANVDASQIAELIPDFKMESGVEQLGLF CCCCCCCCCCCCHHHCCCCHHHHHHHCCCHHHHCCHHHHCCC >Mature Secondary Structure TVLQDTFEANRLRLQSELDAGKTQAERNRLGQFATPTALALDILTYASTLIPEDEPVRF CCCHHHHHHHHHHHHHHHCCCHHHHHHHHCCCCCCHHHHHHHHHHHHHHHCCCCCCCCE LDPAVGTGSFFSAFRQVFPAGRIDSALGFEVDTHYGEPATHIWRDTGFTIRLADFTASEP ECCCCCCCHHHHHHHHHCCCCCCCCCCCCEEECCCCCCHHHHCCCCCCEEEEEECCCCCC SVPFNLVICNPPYVRHHHLQNGDKLRLQAKTACASGMKISGLAGLYCHFLGLSHSWMAEG CCCEEEEEECCCCHHHHCCCCCCEEEEEEHHHHHCCCEECHHHHHHHHHHCCCCCHHHCC GIAGWLIPSEFMDVNYGKAIKRYLLEKVTLLKIHRFDPDDVQFADALVSSAVVWFRKAPP CEEEEECCHHHHCCCHHHHHHHHHHHHHHHHEEECCCCCHHHHHHHHHHHHHHHHCCCCC PENHQVSFTFGGSLLEPRCSRDVLAEDLAREAKWTRFPKATGIGTKEARALIADFFHIRR CCCCEEEEEECCCCCCCCCCHHHHHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHH GIATGDNAFFILDRKEIVAKNLPMELFRPILPSPRYLVENEILAAADGYPLLDRQLFLLD CCCCCCCEEEEEECHHHHHHCCCHHHHHHCCCCCCEECCCCEEEECCCCCCCCCEEEEEE TKLPEETIKERYPALYAYLEEGKAVGVHERYLCRNRTPWYSQENRPSAPIVCTYLGRSNT CCCCHHHHHHHHHHHHHHHHCCCCCCCHHHHHHCCCCCCCCCCCCCCCCEEEEECCCCCC KSGRPFRFILNNSMATVANVYLALYPKPQLAKAVSQNPSLIRSVWEVLNRITPEQLLGES CCCCCEEEEECCCHHHHHHHHHEECCCHHHHHHHCCCHHHHHHHHHHHHCCCHHHHHCCC RVYGGGLHKLEPNELANVDASQIAELIPDFKMESGVEQLGLF CCCCCCCCCCCCHHHCCCCHHHHHHHCCCHHHHCCHHHHCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 7828868 [H]