| Definition | Streptococcus pneumoniae D39, complete genome. |
|---|---|
| Accession | NC_008533 |
| Length | 2,046,115 |
Click here to switch to the map view.
The map label for this gene is rsmF [H]
Identifier: 116516379
GI number: 116516379
Start: 1264611
End: 1265915
Strand: Reverse
Name: rsmF [H]
Synonym: SPD_1233
Alternate gene names: 116516379
Gene position: 1265915-1264611 (Counterclockwise)
Preceding gene: 116515379
Following gene: 116517085
Centisome position: 61.87
GC content: 45.52
Gene sequence:
>1305_bases ATGCAATTTCCAGAAGGATTTGTTGAAAAATATAAAGAGATACTAGGAGATGAGGCAAGAGATTTTCTTGCCTCTTTTGA GGAGGAAGCGGTTTCGGCCTTTCGGGTCAATCCCTTAAAAGAAGAGCAACTTTCCTTTTCTGATGCCATTACTCAAACCC CTTGGGGCCACTATGGGAAGGTTTCAGGGAAATCGCCTGAGCATGCTACAGGTTTAGTTTATTCGCAAGAACCTGCTGCT CAAATGGTGGCTCAAGTAGCCCAACCCAGTCCTGGTATGAAGGTCTTGGACTTGGCTGCTGCACCGGGGGGCAAATCAAC TCAACTGGCAGCCTATCTAGCAGGTGAGGGGCTACTTGTTTCCAATGAAATTTCAAGCAAACGGGCTAAGATTTTGGTTG AAAACATGGAGCGTTTTGGAGCGACAAATGTCGTGGTGACCAATGAATCTGCCGACCGCTTGGTCAAGGTCTTTAAAGGC TATTTTGACTTAATCGTTCTTGATGCCCCTTGCTCTGGTGAAGGAATGTTTCGTAAGCAACCTGATGCTATGGACTATTG GAGCTTAGATTATCCGAGTCAATGTGCTAGCTTGCAAAGAGAAATTCTGGAGGATGCAGTGACCATGTTAGCTGAAGGTG GTCGTCTGGTTTATTCGACCTGTACCTGGGCACCCGAGGAAAACGAAGAGATTGTCAATTGGTTGCTGGAAGAGTATGAT TTTGACTTGTTGCCAGTAGAGCATATCAATGGAATGGTAGCTGGTATTGACCTGCCAGAAACGGCTCGGATGTACCCTCA TCAGTTTAAGGGAGAGGGTCAGTTTGTTGCCCATCTACAGTTTAAGGGTAACAATCCAGCTCCTAAATTTAAGGCAAGTA AGAGTAACCTCAGCCGTGAACAAGTTGCCTTGTGGCAGGAATTTGCCCAAAACCATTTGAAGGTCAATCTACCGGGTATC TTGCAGACTTTTGGAGACCAGCTTTATCTCTTGCCAGAACTTTTGCCAGATTTAGGGAAGCTCAAGATTGCTCGCAATGG ACTGCATCTGGGCACTTTTAAGAAGAAACGCTTTGAGCCCAGTTTCGCTCTTGGTTTAGCCTTGAAACCGAGTCAGGTCG AACAGTCGGTTGAAATTGGCCAAGAAGCGTTTGTCAAGTATGCGGCTGGAGAAACCGTTCAGCTGGCAGAAAGTCTGCCA AATGGTTGGTACCAAGTTTTGGTTAAAGGCAATGGCTTGGGCTTTGCAAAGGTTACTGGAAATGTTTTGAAAAATTATTT TCCAAAAGGCCTCAGATTCAAATGA
Upstream 100 bases:
>100_bases TGAAGCTCCTGATTTTCAAACCAGACAGCCGGTCATGATGGTGCCTCTTGAGATGCAGGAGGAAATTCAGTCCTATATTT ACGAAAGGAAAAGAACTTAA
Downstream 100 bases:
>100_bases AAATGCTAGTCAAATATCTTATTCTATGTTATAGTGAAAGTATGGATTTTTTTAGTAGGATGATTCTTGATATCTTGATT GCCATCACATGTAGTTTTAC
Product: NOL1/NOP2/sun family protein
Products: NA
Alternate protein names: 16S rRNA m5C1407 methyltransferase; rRNA (cytosine-C(5)-)-methyltransferase rsmF [H]
Number of amino acids: Translated: 434; Mature: 434
Protein sequence:
>434_residues MQFPEGFVEKYKEILGDEARDFLASFEEEAVSAFRVNPLKEEQLSFSDAITQTPWGHYGKVSGKSPEHATGLVYSQEPAA QMVAQVAQPSPGMKVLDLAAAPGGKSTQLAAYLAGEGLLVSNEISSKRAKILVENMERFGATNVVVTNESADRLVKVFKG YFDLIVLDAPCSGEGMFRKQPDAMDYWSLDYPSQCASLQREILEDAVTMLAEGGRLVYSTCTWAPEENEEIVNWLLEEYD FDLLPVEHINGMVAGIDLPETARMYPHQFKGEGQFVAHLQFKGNNPAPKFKASKSNLSREQVALWQEFAQNHLKVNLPGI LQTFGDQLYLLPELLPDLGKLKIARNGLHLGTFKKKRFEPSFALGLALKPSQVEQSVEIGQEAFVKYAAGETVQLAESLP NGWYQVLVKGNGLGFAKVTGNVLKNYFPKGLRFK
Sequences:
>Translated_434_residues MQFPEGFVEKYKEILGDEARDFLASFEEEAVSAFRVNPLKEEQLSFSDAITQTPWGHYGKVSGKSPEHATGLVYSQEPAA QMVAQVAQPSPGMKVLDLAAAPGGKSTQLAAYLAGEGLLVSNEISSKRAKILVENMERFGATNVVVTNESADRLVKVFKG YFDLIVLDAPCSGEGMFRKQPDAMDYWSLDYPSQCASLQREILEDAVTMLAEGGRLVYSTCTWAPEENEEIVNWLLEEYD FDLLPVEHINGMVAGIDLPETARMYPHQFKGEGQFVAHLQFKGNNPAPKFKASKSNLSREQVALWQEFAQNHLKVNLPGI LQTFGDQLYLLPELLPDLGKLKIARNGLHLGTFKKKRFEPSFALGLALKPSQVEQSVEIGQEAFVKYAAGETVQLAESLP NGWYQVLVKGNGLGFAKVTGNVLKNYFPKGLRFK >Mature_434_residues MQFPEGFVEKYKEILGDEARDFLASFEEEAVSAFRVNPLKEEQLSFSDAITQTPWGHYGKVSGKSPEHATGLVYSQEPAA QMVAQVAQPSPGMKVLDLAAAPGGKSTQLAAYLAGEGLLVSNEISSKRAKILVENMERFGATNVVVTNESADRLVKVFKG YFDLIVLDAPCSGEGMFRKQPDAMDYWSLDYPSQCASLQREILEDAVTMLAEGGRLVYSTCTWAPEENEEIVNWLLEEYD FDLLPVEHINGMVAGIDLPETARMYPHQFKGEGQFVAHLQFKGNNPAPKFKASKSNLSREQVALWQEFAQNHLKVNLPGI LQTFGDQLYLLPELLPDLGKLKIARNGLHLGTFKKKRFEPSFALGLALKPSQVEQSVEIGQEAFVKYAAGETVQLAESLP NGWYQVLVKGNGLGFAKVTGNVLKNYFPKGLRFK
Specific function: Specifically methylates the cytosine at position 1407 (m5C1407) of 16S rRNA [H]
COG id: COG0144
COG function: function code J; tRNA and rRNA cytosine-C5-methylases
Gene ontology:
Cell location: Cytoplasm (Potential) [H]
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the methyltransferase superfamily. RsmB/NOP family [H]
Homologues:
Organism=Homo sapiens, GI76150625, Length=307, Percent_Identity=28.3387622149837, Blast_Score=124, Evalue=2e-28, Organism=Homo sapiens, GI76150623, Length=307, Percent_Identity=28.3387622149837, Blast_Score=124, Evalue=2e-28, Organism=Homo sapiens, GI301336155, Length=262, Percent_Identity=29.3893129770992, Blast_Score=109, Evalue=5e-24, Organism=Homo sapiens, GI39995082, Length=264, Percent_Identity=30.3030303030303, Blast_Score=108, Evalue=7e-24, Organism=Homo sapiens, GI32698918, Length=179, Percent_Identity=32.9608938547486, Blast_Score=97, Evalue=2e-20, Organism=Homo sapiens, GI11545785, Length=183, Percent_Identity=32.2404371584699, Blast_Score=78, Evalue=1e-14, Organism=Homo sapiens, GI270288818, Length=215, Percent_Identity=29.3023255813954, Blast_Score=76, Evalue=6e-14, Organism=Homo sapiens, GI8922322, Length=215, Percent_Identity=29.3023255813954, Blast_Score=76, Evalue=8e-14, Organism=Homo sapiens, GI23199998, Length=215, Percent_Identity=29.3023255813954, Blast_Score=75, Evalue=8e-14, Organism=Homo sapiens, GI270288816, Length=215, Percent_Identity=29.3023255813954, Blast_Score=75, Evalue=1e-13, Organism=Escherichia coli, GI87081985, Length=461, Percent_Identity=30.8026030368764, Blast_Score=177, Evalue=1e-45, Organism=Escherichia coli, GI2367212, Length=177, Percent_Identity=35.5932203389831, Blast_Score=93, Evalue=4e-20, Organism=Caenorhabditis elegans, GI17536757, Length=297, Percent_Identity=29.6296296296296, Blast_Score=130, Evalue=1e-30, Organism=Caenorhabditis elegans, GI25143471, Length=183, Percent_Identity=31.1475409836066, Blast_Score=91, Evalue=2e-18, Organism=Saccharomyces cerevisiae, GI6324268, Length=297, Percent_Identity=29.6296296296296, Blast_Score=119, Evalue=1e-27, Organism=Saccharomyces cerevisiae, GI6319447, Length=181, Percent_Identity=32.5966850828729, Blast_Score=101, Evalue=2e-22, Organism=Drosophila melanogaster, GI22024126, Length=280, Percent_Identity=29.2857142857143, Blast_Score=128, Evalue=9e-30, Organism=Drosophila melanogaster, GI21355201, Length=191, Percent_Identity=32.4607329842932, Blast_Score=102, Evalue=5e-22, Organism=Drosophila melanogaster, GI21356513, Length=173, Percent_Identity=30.635838150289, Blast_Score=83, Evalue=3e-16, Organism=Drosophila melanogaster, GI24668781, Length=172, Percent_Identity=30.8139534883721, Blast_Score=83, Evalue=3e-16,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR001678 - InterPro: IPR018314 - InterPro: IPR011023 [H]
Pfam domain/function: PF01189 Nol1_Nop2_Fmu [H]
EC number: =2.1.1.178 [H]
Molecular weight: Translated: 48050; Mature: 48050
Theoretical pI: Translated: 5.12; Mature: 5.12
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.7 %Cys (Translated Protein) 2.1 %Met (Translated Protein) 2.8 %Cys+Met (Translated Protein) 0.7 %Cys (Mature Protein) 2.1 %Met (Mature Protein) 2.8 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MQFPEGFVEKYKEILGDEARDFLASFEEEAVSAFRVNPLKEEQLSFSDAITQTPWGHYGK CCCCHHHHHHHHHHHCHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHCCCCCCCCC VSGKSPEHATGLVYSQEPAAQMVAQVAQPSPGMKVLDLAAAPGGKSTQLAAYLAGEGLLV CCCCCCCCCCCEEECCCHHHHHHHHHHCCCCCCEEEEEECCCCCCCCEEEEEEECCCEEE SNEISSKRAKILVENMERFGATNVVVTNESADRLVKVFKGYFDLIVLDAPCSGEGMFRKQ ECCHHHHHHHHHHHHHHHCCCCEEEEECCCHHHHHHHHHHHEEEEEEECCCCCCCCCCCC PDAMDYWSLDYPSQCASLQREILEDAVTMLAEGGRLVYSTCTWAPEENEEIVNWLLEEYD CCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHCCCEEEEEEECCCCCCCHHHHHHHHHHCC FDLLPVEHINGMVAGIDLPETARMYPHQFKGEGQFVAHLQFKGNNPAPKFKASKSNLSRE CCCEEHHHHCCEEEECCCCHHHHCCCCCCCCCCCEEEEEEEECCCCCCCCCCCHHCCCHH QVALWQEFAQNHLKVNLPGILQTFGDQLYLLPELLPDLGKLKIARNGLHLGTFKKKRFEP HHHHHHHHHHCCEEEECCHHHHHHCCCEEEHHHHCCCHHHEEECCCCCEECCCHHHHCCC SFALGLALKPSQVEQSVEIGQEAFVKYAAGETVQLAESLPNGWYQVLVKGNGLGFAKVTG CCEEEEEECHHHHHHHHHHHHHHHHHHHCCCHHHHHHHCCCCEEEEEEECCCCEEHHHHH NVLKNYFPKGLRFK HHHHHHCCCCCCCC >Mature Secondary Structure MQFPEGFVEKYKEILGDEARDFLASFEEEAVSAFRVNPLKEEQLSFSDAITQTPWGHYGK CCCCHHHHHHHHHHHCHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHCCCCCCCCC VSGKSPEHATGLVYSQEPAAQMVAQVAQPSPGMKVLDLAAAPGGKSTQLAAYLAGEGLLV CCCCCCCCCCCEEECCCHHHHHHHHHHCCCCCCEEEEEECCCCCCCCEEEEEEECCCEEE SNEISSKRAKILVENMERFGATNVVVTNESADRLVKVFKGYFDLIVLDAPCSGEGMFRKQ ECCHHHHHHHHHHHHHHHCCCCEEEEECCCHHHHHHHHHHHEEEEEEECCCCCCCCCCCC PDAMDYWSLDYPSQCASLQREILEDAVTMLAEGGRLVYSTCTWAPEENEEIVNWLLEEYD CCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHCCCEEEEEEECCCCCCCHHHHHHHHHHCC FDLLPVEHINGMVAGIDLPETARMYPHQFKGEGQFVAHLQFKGNNPAPKFKASKSNLSRE CCCEEHHHHCCEEEECCCCHHHHCCCCCCCCCCCEEEEEEEECCCCCCCCCCCHHCCCHH QVALWQEFAQNHLKVNLPGILQTFGDQLYLLPELLPDLGKLKIARNGLHLGTFKKKRFEP HHHHHHHHHHCCEEEECCHHHHHHCCCEEEHHHHCCCHHHEEECCCCCEECCCHHHHCCC SFALGLALKPSQVEQSVEIGQEAFVKYAAGETVQLAESLPNGWYQVLVKGNGLGFAKVTG CCEEEEEECHHHHHHHHHHHHHHHHHHHCCCHHHHHHHCCCCEEEEEEECCCCEEHHHHH NVLKNYFPKGLRFK HHHHHHCCCCCCCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 10952301 [H]