| Definition | Herpetosiphon aurantiacus ATCC 23779 chromosome, complete genome. |
|---|---|
| Accession | NC_009972 |
| Length | 6,346,587 |
Click here to switch to the map view.
The map label for this gene is rsmF [H]
Identifier: 159898460
GI number: 159898460
Start: 2345455
End: 2346900
Strand: Reverse
Name: rsmF [H]
Synonym: Haur_1936
Alternate gene names: 159898460
Gene position: 2346900-2345455 (Counterclockwise)
Preceding gene: 159898461
Following gene: 159898457
Centisome position: 36.98
GC content: 53.94
Gene sequence:
>1446_bases ATGACACGTCAACTACCGCGACAGCTTGAAGCCTATCGCGATTTACTGAATGAAACCGAGCTTAACCAACTGTTGGAGAG CATCAACCAACCATTGCCCAGCGGCCTGCGCACCAATCCGCTCAAGGCGAGTGCAAACGGCCCGCAAGCCTGGCAACAAC AGTATGGCTGGCAACTAGAGCAAGTGCCATTTTGCCCAACGGGATGGCAACTCCGCAACGAGGTTGGCAACTTAAGCCGC ACCGTCGAGCATCAAATGGGCCATTACTACATCCAAGATGCCGCCTCGATGTTGCCCGTTGAGCTATTTGAATTGCCCCC TGAGGCCGAACCAAGTGTGCTGGATTTGACCGCTGCTCCTGGCGGCAAAACCACCCATATCATCTCGCAACTGCAAGATC GTGGGCTGGTGGTGGCCAACGACAGCAACTTACAACGGATTGCTGGCCTCAAAGGCAATATTCAGCGCTGGGGCAGCACC TCGGCGGTGATCACTAACCAACCAGGCGAGCGTATGGGTCGTTGGTTGCCCGAACAATTCGATTATGTTTTATTGGATGC GCCGTGTAGTGGTGAAGCGCTGCGCACCAGCGAACGCCACACCAGCCGTCTGGTTTCGAGCCACGAACGCAACACCCTAC AACAACGCCAAATTAAGTTGCTTGAAAGTGCCTTGCAAGCGGCGCGACCGAATGGCCATGTGGTTTATTCGACCTGTAGC CTTGCGCCCGAAGAAGATGAGGCGGTGCTTGATGCGCTGCTCAAACGCTACCCTGAGCAAATTCAGATTATGTCAATTCC AACCAGCGTGCCAATTGAAGCGCCTGGCTTGTTGGCGGCAGGCTCACAGCATTACGATCCCAGCATCGCCAAGGCCTTGC GTTTATGGCCGCATCTCTACAACACCGCCGGATTTTTCGCTGCGCTGATTATCAAGCGTGATCAGATTGCCACGCCCAGC CTAGAGCGCCCGCAACAAACCCTAGCCAAAGCTGGCTACAAAGCAGTTACTGCCGACGAACAGCGCCAAATTCTTGATAC ATTGCACGCTGTGTATGGCTTTGATCTGGGTAAAATTTTAGAAGCCAACGGCCTGAGTTTATGGCGTAACGGCAAAACAA TTCAGGCGATTCCAGAGCGCTGGCTCAACAATTTCGAGCACTTTCCATTTGTCAGTGCAGGGATTCAGGTTGGCAAACTA TCGCGGCATGGATTCCAACCAGCCCATGATTTGGCTTCGCGCTATGCCGAGCAATTCAGCCAACAATGGCTCACGATCAA CGATCAACAGATTGACGATTGGCTCGCCCGCCGCGATCTACCGCTGAAAACCAGCACGTATGCAGCTGGCAGCATCGTGG TGGTGCGCGATCAGCAGCAGCGCTACCTTGGTTTAGGCCAAATCGACGGCAACAGCCTAGAAAATTTGCTGCCGCATTGG CAATAG
Upstream 100 bases:
>100_bases CAGGCGAGGGGGAACCACCAAACCAAATGCTCCCCTCGCCCGCCGCCGTGGGAGAGGGGTCGGGGGTGAGGGAACTACGA TCCCGCATAAAGGAACAACA
Downstream 100 bases:
>100_bases AGGCTATGAGCTTATACAGCGCGATCCCTCACCCCAACCCCTCTCCCATCGCGGCGGGCGAGGGGAGATCCAAGGCTCAT GATGGGATGGTTCCCCCTCG
Product: NOL1/NOP2/sun family RNA methylase
Products: NA
Alternate protein names: 16S rRNA m5C1407 methyltransferase; rRNA (cytosine-C(5)-)-methyltransferase rsmF [H]
Number of amino acids: Translated: 481; Mature: 480
Protein sequence:
>481_residues MTRQLPRQLEAYRDLLNETELNQLLESINQPLPSGLRTNPLKASANGPQAWQQQYGWQLEQVPFCPTGWQLRNEVGNLSR TVEHQMGHYYIQDAASMLPVELFELPPEAEPSVLDLTAAPGGKTTHIISQLQDRGLVVANDSNLQRIAGLKGNIQRWGST SAVITNQPGERMGRWLPEQFDYVLLDAPCSGEALRTSERHTSRLVSSHERNTLQQRQIKLLESALQAARPNGHVVYSTCS LAPEEDEAVLDALLKRYPEQIQIMSIPTSVPIEAPGLLAAGSQHYDPSIAKALRLWPHLYNTAGFFAALIIKRDQIATPS LERPQQTLAKAGYKAVTADEQRQILDTLHAVYGFDLGKILEANGLSLWRNGKTIQAIPERWLNNFEHFPFVSAGIQVGKL SRHGFQPAHDLASRYAEQFSQQWLTINDQQIDDWLARRDLPLKTSTYAAGSIVVVRDQQQRYLGLGQIDGNSLENLLPHW Q
Sequences:
>Translated_481_residues MTRQLPRQLEAYRDLLNETELNQLLESINQPLPSGLRTNPLKASANGPQAWQQQYGWQLEQVPFCPTGWQLRNEVGNLSR TVEHQMGHYYIQDAASMLPVELFELPPEAEPSVLDLTAAPGGKTTHIISQLQDRGLVVANDSNLQRIAGLKGNIQRWGST SAVITNQPGERMGRWLPEQFDYVLLDAPCSGEALRTSERHTSRLVSSHERNTLQQRQIKLLESALQAARPNGHVVYSTCS LAPEEDEAVLDALLKRYPEQIQIMSIPTSVPIEAPGLLAAGSQHYDPSIAKALRLWPHLYNTAGFFAALIIKRDQIATPS LERPQQTLAKAGYKAVTADEQRQILDTLHAVYGFDLGKILEANGLSLWRNGKTIQAIPERWLNNFEHFPFVSAGIQVGKL SRHGFQPAHDLASRYAEQFSQQWLTINDQQIDDWLARRDLPLKTSTYAAGSIVVVRDQQQRYLGLGQIDGNSLENLLPHW Q >Mature_480_residues TRQLPRQLEAYRDLLNETELNQLLESINQPLPSGLRTNPLKASANGPQAWQQQYGWQLEQVPFCPTGWQLRNEVGNLSRT VEHQMGHYYIQDAASMLPVELFELPPEAEPSVLDLTAAPGGKTTHIISQLQDRGLVVANDSNLQRIAGLKGNIQRWGSTS AVITNQPGERMGRWLPEQFDYVLLDAPCSGEALRTSERHTSRLVSSHERNTLQQRQIKLLESALQAARPNGHVVYSTCSL APEEDEAVLDALLKRYPEQIQIMSIPTSVPIEAPGLLAAGSQHYDPSIAKALRLWPHLYNTAGFFAALIIKRDQIATPSL ERPQQTLAKAGYKAVTADEQRQILDTLHAVYGFDLGKILEANGLSLWRNGKTIQAIPERWLNNFEHFPFVSAGIQVGKLS RHGFQPAHDLASRYAEQFSQQWLTINDQQIDDWLARRDLPLKTSTYAAGSIVVVRDQQQRYLGLGQIDGNSLENLLPHWQ
Specific function: Specifically methylates the cytosine at position 1407 (m5C1407) of 16S rRNA [H]
COG id: COG0144
COG function: function code J; tRNA and rRNA cytosine-C5-methylases
Gene ontology:
Cell location: Cytoplasm (Potential) [H]
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the methyltransferase superfamily. RsmB/NOP family [H]
Homologues:
Organism=Homo sapiens, GI76150625, Length=307, Percent_Identity=31.5960912052117, Blast_Score=149, Evalue=5e-36, Organism=Homo sapiens, GI76150623, Length=307, Percent_Identity=31.5960912052117, Blast_Score=149, Evalue=5e-36, Organism=Homo sapiens, GI301336155, Length=362, Percent_Identity=25.1381215469613, Blast_Score=99, Evalue=7e-21, Organism=Homo sapiens, GI11545785, Length=192, Percent_Identity=35.4166666666667, Blast_Score=99, Evalue=8e-21, Organism=Homo sapiens, GI39995082, Length=380, Percent_Identity=25.2631578947368, Blast_Score=97, Evalue=2e-20, Organism=Homo sapiens, GI40316918, Length=187, Percent_Identity=35.8288770053476, Blast_Score=96, Evalue=7e-20, Organism=Homo sapiens, GI32698918, Length=222, Percent_Identity=33.7837837837838, Blast_Score=94, Evalue=2e-19, Organism=Homo sapiens, GI270288816, Length=250, Percent_Identity=30, Blast_Score=87, Evalue=3e-17, Organism=Homo sapiens, GI23199998, Length=239, Percent_Identity=30.1255230125523, Blast_Score=85, Evalue=1e-16, Organism=Homo sapiens, GI8922322, Length=239, Percent_Identity=30.1255230125523, Blast_Score=85, Evalue=2e-16, Organism=Homo sapiens, GI270288818, Length=239, Percent_Identity=30.1255230125523, Blast_Score=85, Evalue=2e-16, Organism=Escherichia coli, GI87081985, Length=461, Percent_Identity=28.8503253796095, Blast_Score=191, Evalue=8e-50, Organism=Escherichia coli, GI2367212, Length=153, Percent_Identity=35.9477124183007, Blast_Score=87, Evalue=2e-18, Organism=Caenorhabditis elegans, GI17536757, Length=307, Percent_Identity=34.2019543973941, Blast_Score=165, Evalue=6e-41, Organism=Caenorhabditis elegans, GI25143471, Length=285, Percent_Identity=28.0701754385965, Blast_Score=96, Evalue=5e-20, Organism=Caenorhabditis elegans, GI17509941, Length=167, Percent_Identity=32.3353293413174, Blast_Score=75, Evalue=1e-13, Organism=Caenorhabditis elegans, GI71998419, Length=230, Percent_Identity=29.1304347826087, Blast_Score=71, Evalue=1e-12, Organism=Caenorhabditis elegans, GI115534021, Length=230, Percent_Identity=29.1304347826087, Blast_Score=71, Evalue=1e-12, Organism=Saccharomyces cerevisiae, GI6324268, Length=310, Percent_Identity=33.5483870967742, Blast_Score=159, Evalue=1e-39, Organism=Saccharomyces cerevisiae, GI6319447, Length=285, Percent_Identity=27.0175438596491, Blast_Score=105, Evalue=1e-23, Organism=Drosophila melanogaster, GI22024126, Length=309, Percent_Identity=33.0097087378641, Blast_Score=153, Evalue=2e-37, Organism=Drosophila melanogaster, GI24668781, Length=241, Percent_Identity=32.7800829875519, Blast_Score=94, Evalue=2e-19, Organism=Drosophila melanogaster, GI21356513, Length=241, Percent_Identity=32.7800829875519, Blast_Score=94, Evalue=2e-19, Organism=Drosophila melanogaster, GI21355201, Length=298, Percent_Identity=27.1812080536913, Blast_Score=86, Evalue=5e-17, Organism=Drosophila melanogaster, GI21356579, Length=239, Percent_Identity=29.2887029288703, Blast_Score=78, Evalue=1e-14, Organism=Drosophila melanogaster, GI19920494, Length=178, Percent_Identity=28.6516853932584, Blast_Score=78, Evalue=1e-14,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR001678 - InterPro: IPR018314 - InterPro: IPR011023 [H]
Pfam domain/function: PF01189 Nol1_Nop2_Fmu [H]
EC number: =2.1.1.178 [H]
Molecular weight: Translated: 53944; Mature: 53812
Theoretical pI: Translated: 6.45; Mature: 6.45
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.6 %Cys (Translated Protein) 1.0 %Met (Translated Protein) 1.7 %Cys+Met (Translated Protein) 0.6 %Cys (Mature Protein) 0.8 %Met (Mature Protein) 1.5 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MTRQLPRQLEAYRDLLNETELNQLLESINQPLPSGLRTNPLKASANGPQAWQQQYGWQLE CCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCHHHHHHHHCCCCC QVPFCPTGWQLRNEVGNLSRTVEHQMGHYYIQDAASMLPVELFELPPEAEPSVLDLTAAP CCCCCCCCHHHHHHHHHHHHHHHHHHCHHHHHHHHHHCCHHHHCCCCCCCCCEEEEECCC GGKTTHIISQLQDRGLVVANDSNLQRIAGLKGNIQRWGSTSAVITNQPGERMGRWLPEQF CCCHHHHHHHHHHCCEEEECCCCHHHHHCCCCCHHHCCCCCEEEECCCHHHHHCCCCHHC DYVLLDAPCSGEALRTSERHTSRLVSSHERNTLQQRQIKLLESALQAARPNGHVVYSTCS CEEEEECCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCEEEEEEC LAPEEDEAVLDALLKRYPEQIQIMSIPTSVPIEAPGLLAAGSQHYDPSIAKALRLWPHLY CCCCCHHHHHHHHHHHCCCCEEEEECCCCCCCCCCCCEECCCCCCCHHHHHHHHHHHHHH NTAGFFAALIIKRDQIATPSLERPQQTLAKAGYKAVTADEQRQILDTLHAVYGFDLGKIL HHHHHHHHHHHHCCCCCCCCCCCHHHHHHHCCCCCCCCHHHHHHHHHHHHHHCCCHHHHH EANGLSLWRNGKTIQAIPERWLNNFEHFPFVSAGIQVGKLSRHGFQPAHDLASRYAEQFS HCCCCEEECCCCHHHHHHHHHHCCCCCCCCHHCCCEECCHHHCCCCCHHHHHHHHHHHHH QQWLTINDQQIDDWLARRDLPLKTSTYAAGSIVVVRDQQQRYLGLGQIDGNSLENLLPHW HCCCCCCHHHHHHHHHHCCCCCCCCCCCCCEEEEEECCCCHHCCCCCCCCCCHHHHCCCC Q C >Mature Secondary Structure TRQLPRQLEAYRDLLNETELNQLLESINQPLPSGLRTNPLKASANGPQAWQQQYGWQLE CCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCHHHHHHHHCCCCC QVPFCPTGWQLRNEVGNLSRTVEHQMGHYYIQDAASMLPVELFELPPEAEPSVLDLTAAP CCCCCCCCHHHHHHHHHHHHHHHHHHCHHHHHHHHHHCCHHHHCCCCCCCCCEEEEECCC GGKTTHIISQLQDRGLVVANDSNLQRIAGLKGNIQRWGSTSAVITNQPGERMGRWLPEQF CCCHHHHHHHHHHCCEEEECCCCHHHHHCCCCCHHHCCCCCEEEECCCHHHHHCCCCHHC DYVLLDAPCSGEALRTSERHTSRLVSSHERNTLQQRQIKLLESALQAARPNGHVVYSTCS CEEEEECCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCEEEEEEC LAPEEDEAVLDALLKRYPEQIQIMSIPTSVPIEAPGLLAAGSQHYDPSIAKALRLWPHLY CCCCCHHHHHHHHHHHCCCCEEEEECCCCCCCCCCCCEECCCCCCCHHHHHHHHHHHHHH NTAGFFAALIIKRDQIATPSLERPQQTLAKAGYKAVTADEQRQILDTLHAVYGFDLGKIL HHHHHHHHHHHHCCCCCCCCCCCHHHHHHHCCCCCCCCHHHHHHHHHHHHHHCCCHHHHH EANGLSLWRNGKTIQAIPERWLNNFEHFPFVSAGIQVGKLSRHGFQPAHDLASRYAEQFS HCCCCEEECCCCHHHHHHHHHHCCCCCCCCHHCCCEECCHHHCCCCCHHHHHHHHHHHHH QQWLTINDQQIDDWLARRDLPLKTSTYAAGSIVVVRDQQQRYLGLGQIDGNSLENLLPHW HCCCCCCHHHHHHHHHHCCCCCCCCCCCCCEEEEEECCCCHHCCCCCCCCCCHHHHCCCC Q C
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: NA