The gene/protein map for NC_009972 is currently unavailable.
Definition Herpetosiphon aurantiacus ATCC 23779 chromosome, complete genome.
Accession NC_009972
Length 6,346,587

Click here to switch to the map view.

The map label for this gene is rsmF [H]

Identifier: 159898460

GI number: 159898460

Start: 2345455

End: 2346900

Strand: Reverse

Name: rsmF [H]

Synonym: Haur_1936

Alternate gene names: 159898460

Gene position: 2346900-2345455 (Counterclockwise)

Preceding gene: 159898461

Following gene: 159898457

Centisome position: 36.98

GC content: 53.94

Gene sequence:

>1446_bases
ATGACACGTCAACTACCGCGACAGCTTGAAGCCTATCGCGATTTACTGAATGAAACCGAGCTTAACCAACTGTTGGAGAG
CATCAACCAACCATTGCCCAGCGGCCTGCGCACCAATCCGCTCAAGGCGAGTGCAAACGGCCCGCAAGCCTGGCAACAAC
AGTATGGCTGGCAACTAGAGCAAGTGCCATTTTGCCCAACGGGATGGCAACTCCGCAACGAGGTTGGCAACTTAAGCCGC
ACCGTCGAGCATCAAATGGGCCATTACTACATCCAAGATGCCGCCTCGATGTTGCCCGTTGAGCTATTTGAATTGCCCCC
TGAGGCCGAACCAAGTGTGCTGGATTTGACCGCTGCTCCTGGCGGCAAAACCACCCATATCATCTCGCAACTGCAAGATC
GTGGGCTGGTGGTGGCCAACGACAGCAACTTACAACGGATTGCTGGCCTCAAAGGCAATATTCAGCGCTGGGGCAGCACC
TCGGCGGTGATCACTAACCAACCAGGCGAGCGTATGGGTCGTTGGTTGCCCGAACAATTCGATTATGTTTTATTGGATGC
GCCGTGTAGTGGTGAAGCGCTGCGCACCAGCGAACGCCACACCAGCCGTCTGGTTTCGAGCCACGAACGCAACACCCTAC
AACAACGCCAAATTAAGTTGCTTGAAAGTGCCTTGCAAGCGGCGCGACCGAATGGCCATGTGGTTTATTCGACCTGTAGC
CTTGCGCCCGAAGAAGATGAGGCGGTGCTTGATGCGCTGCTCAAACGCTACCCTGAGCAAATTCAGATTATGTCAATTCC
AACCAGCGTGCCAATTGAAGCGCCTGGCTTGTTGGCGGCAGGCTCACAGCATTACGATCCCAGCATCGCCAAGGCCTTGC
GTTTATGGCCGCATCTCTACAACACCGCCGGATTTTTCGCTGCGCTGATTATCAAGCGTGATCAGATTGCCACGCCCAGC
CTAGAGCGCCCGCAACAAACCCTAGCCAAAGCTGGCTACAAAGCAGTTACTGCCGACGAACAGCGCCAAATTCTTGATAC
ATTGCACGCTGTGTATGGCTTTGATCTGGGTAAAATTTTAGAAGCCAACGGCCTGAGTTTATGGCGTAACGGCAAAACAA
TTCAGGCGATTCCAGAGCGCTGGCTCAACAATTTCGAGCACTTTCCATTTGTCAGTGCAGGGATTCAGGTTGGCAAACTA
TCGCGGCATGGATTCCAACCAGCCCATGATTTGGCTTCGCGCTATGCCGAGCAATTCAGCCAACAATGGCTCACGATCAA
CGATCAACAGATTGACGATTGGCTCGCCCGCCGCGATCTACCGCTGAAAACCAGCACGTATGCAGCTGGCAGCATCGTGG
TGGTGCGCGATCAGCAGCAGCGCTACCTTGGTTTAGGCCAAATCGACGGCAACAGCCTAGAAAATTTGCTGCCGCATTGG
CAATAG

Upstream 100 bases:

>100_bases
CAGGCGAGGGGGAACCACCAAACCAAATGCTCCCCTCGCCCGCCGCCGTGGGAGAGGGGTCGGGGGTGAGGGAACTACGA
TCCCGCATAAAGGAACAACA

Downstream 100 bases:

>100_bases
AGGCTATGAGCTTATACAGCGCGATCCCTCACCCCAACCCCTCTCCCATCGCGGCGGGCGAGGGGAGATCCAAGGCTCAT
GATGGGATGGTTCCCCCTCG

Product: NOL1/NOP2/sun family RNA methylase

Products: NA

Alternate protein names: 16S rRNA m5C1407 methyltransferase; rRNA (cytosine-C(5)-)-methyltransferase rsmF [H]

Number of amino acids: Translated: 481; Mature: 480

Protein sequence:

>481_residues
MTRQLPRQLEAYRDLLNETELNQLLESINQPLPSGLRTNPLKASANGPQAWQQQYGWQLEQVPFCPTGWQLRNEVGNLSR
TVEHQMGHYYIQDAASMLPVELFELPPEAEPSVLDLTAAPGGKTTHIISQLQDRGLVVANDSNLQRIAGLKGNIQRWGST
SAVITNQPGERMGRWLPEQFDYVLLDAPCSGEALRTSERHTSRLVSSHERNTLQQRQIKLLESALQAARPNGHVVYSTCS
LAPEEDEAVLDALLKRYPEQIQIMSIPTSVPIEAPGLLAAGSQHYDPSIAKALRLWPHLYNTAGFFAALIIKRDQIATPS
LERPQQTLAKAGYKAVTADEQRQILDTLHAVYGFDLGKILEANGLSLWRNGKTIQAIPERWLNNFEHFPFVSAGIQVGKL
SRHGFQPAHDLASRYAEQFSQQWLTINDQQIDDWLARRDLPLKTSTYAAGSIVVVRDQQQRYLGLGQIDGNSLENLLPHW
Q

Sequences:

>Translated_481_residues
MTRQLPRQLEAYRDLLNETELNQLLESINQPLPSGLRTNPLKASANGPQAWQQQYGWQLEQVPFCPTGWQLRNEVGNLSR
TVEHQMGHYYIQDAASMLPVELFELPPEAEPSVLDLTAAPGGKTTHIISQLQDRGLVVANDSNLQRIAGLKGNIQRWGST
SAVITNQPGERMGRWLPEQFDYVLLDAPCSGEALRTSERHTSRLVSSHERNTLQQRQIKLLESALQAARPNGHVVYSTCS
LAPEEDEAVLDALLKRYPEQIQIMSIPTSVPIEAPGLLAAGSQHYDPSIAKALRLWPHLYNTAGFFAALIIKRDQIATPS
LERPQQTLAKAGYKAVTADEQRQILDTLHAVYGFDLGKILEANGLSLWRNGKTIQAIPERWLNNFEHFPFVSAGIQVGKL
SRHGFQPAHDLASRYAEQFSQQWLTINDQQIDDWLARRDLPLKTSTYAAGSIVVVRDQQQRYLGLGQIDGNSLENLLPHW
Q
>Mature_480_residues
TRQLPRQLEAYRDLLNETELNQLLESINQPLPSGLRTNPLKASANGPQAWQQQYGWQLEQVPFCPTGWQLRNEVGNLSRT
VEHQMGHYYIQDAASMLPVELFELPPEAEPSVLDLTAAPGGKTTHIISQLQDRGLVVANDSNLQRIAGLKGNIQRWGSTS
AVITNQPGERMGRWLPEQFDYVLLDAPCSGEALRTSERHTSRLVSSHERNTLQQRQIKLLESALQAARPNGHVVYSTCSL
APEEDEAVLDALLKRYPEQIQIMSIPTSVPIEAPGLLAAGSQHYDPSIAKALRLWPHLYNTAGFFAALIIKRDQIATPSL
ERPQQTLAKAGYKAVTADEQRQILDTLHAVYGFDLGKILEANGLSLWRNGKTIQAIPERWLNNFEHFPFVSAGIQVGKLS
RHGFQPAHDLASRYAEQFSQQWLTINDQQIDDWLARRDLPLKTSTYAAGSIVVVRDQQQRYLGLGQIDGNSLENLLPHWQ

Specific function: Specifically methylates the cytosine at position 1407 (m5C1407) of 16S rRNA [H]

COG id: COG0144

COG function: function code J; tRNA and rRNA cytosine-C5-methylases

Gene ontology:

Cell location: Cytoplasm (Potential) [H]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the methyltransferase superfamily. RsmB/NOP family [H]

Homologues:

Organism=Homo sapiens, GI76150625, Length=307, Percent_Identity=31.5960912052117, Blast_Score=149, Evalue=5e-36,
Organism=Homo sapiens, GI76150623, Length=307, Percent_Identity=31.5960912052117, Blast_Score=149, Evalue=5e-36,
Organism=Homo sapiens, GI301336155, Length=362, Percent_Identity=25.1381215469613, Blast_Score=99, Evalue=7e-21,
Organism=Homo sapiens, GI11545785, Length=192, Percent_Identity=35.4166666666667, Blast_Score=99, Evalue=8e-21,
Organism=Homo sapiens, GI39995082, Length=380, Percent_Identity=25.2631578947368, Blast_Score=97, Evalue=2e-20,
Organism=Homo sapiens, GI40316918, Length=187, Percent_Identity=35.8288770053476, Blast_Score=96, Evalue=7e-20,
Organism=Homo sapiens, GI32698918, Length=222, Percent_Identity=33.7837837837838, Blast_Score=94, Evalue=2e-19,
Organism=Homo sapiens, GI270288816, Length=250, Percent_Identity=30, Blast_Score=87, Evalue=3e-17,
Organism=Homo sapiens, GI23199998, Length=239, Percent_Identity=30.1255230125523, Blast_Score=85, Evalue=1e-16,
Organism=Homo sapiens, GI8922322, Length=239, Percent_Identity=30.1255230125523, Blast_Score=85, Evalue=2e-16,
Organism=Homo sapiens, GI270288818, Length=239, Percent_Identity=30.1255230125523, Blast_Score=85, Evalue=2e-16,
Organism=Escherichia coli, GI87081985, Length=461, Percent_Identity=28.8503253796095, Blast_Score=191, Evalue=8e-50,
Organism=Escherichia coli, GI2367212, Length=153, Percent_Identity=35.9477124183007, Blast_Score=87, Evalue=2e-18,
Organism=Caenorhabditis elegans, GI17536757, Length=307, Percent_Identity=34.2019543973941, Blast_Score=165, Evalue=6e-41,
Organism=Caenorhabditis elegans, GI25143471, Length=285, Percent_Identity=28.0701754385965, Blast_Score=96, Evalue=5e-20,
Organism=Caenorhabditis elegans, GI17509941, Length=167, Percent_Identity=32.3353293413174, Blast_Score=75, Evalue=1e-13,
Organism=Caenorhabditis elegans, GI71998419, Length=230, Percent_Identity=29.1304347826087, Blast_Score=71, Evalue=1e-12,
Organism=Caenorhabditis elegans, GI115534021, Length=230, Percent_Identity=29.1304347826087, Blast_Score=71, Evalue=1e-12,
Organism=Saccharomyces cerevisiae, GI6324268, Length=310, Percent_Identity=33.5483870967742, Blast_Score=159, Evalue=1e-39,
Organism=Saccharomyces cerevisiae, GI6319447, Length=285, Percent_Identity=27.0175438596491, Blast_Score=105, Evalue=1e-23,
Organism=Drosophila melanogaster, GI22024126, Length=309, Percent_Identity=33.0097087378641, Blast_Score=153, Evalue=2e-37,
Organism=Drosophila melanogaster, GI24668781, Length=241, Percent_Identity=32.7800829875519, Blast_Score=94, Evalue=2e-19,
Organism=Drosophila melanogaster, GI21356513, Length=241, Percent_Identity=32.7800829875519, Blast_Score=94, Evalue=2e-19,
Organism=Drosophila melanogaster, GI21355201, Length=298, Percent_Identity=27.1812080536913, Blast_Score=86, Evalue=5e-17,
Organism=Drosophila melanogaster, GI21356579, Length=239, Percent_Identity=29.2887029288703, Blast_Score=78, Evalue=1e-14,
Organism=Drosophila melanogaster, GI19920494, Length=178, Percent_Identity=28.6516853932584, Blast_Score=78, Evalue=1e-14,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR001678
- InterPro:   IPR018314
- InterPro:   IPR011023 [H]

Pfam domain/function: PF01189 Nol1_Nop2_Fmu [H]

EC number: =2.1.1.178 [H]

Molecular weight: Translated: 53944; Mature: 53812

Theoretical pI: Translated: 6.45; Mature: 6.45

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.6 %Cys     (Translated Protein)
1.0 %Met     (Translated Protein)
1.7 %Cys+Met (Translated Protein)
0.6 %Cys     (Mature Protein)
0.8 %Met     (Mature Protein)
1.5 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MTRQLPRQLEAYRDLLNETELNQLLESINQPLPSGLRTNPLKASANGPQAWQQQYGWQLE
CCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCHHHHHHHHCCCCC
QVPFCPTGWQLRNEVGNLSRTVEHQMGHYYIQDAASMLPVELFELPPEAEPSVLDLTAAP
CCCCCCCCHHHHHHHHHHHHHHHHHHCHHHHHHHHHHCCHHHHCCCCCCCCCEEEEECCC
GGKTTHIISQLQDRGLVVANDSNLQRIAGLKGNIQRWGSTSAVITNQPGERMGRWLPEQF
CCCHHHHHHHHHHCCEEEECCCCHHHHHCCCCCHHHCCCCCEEEECCCHHHHHCCCCHHC
DYVLLDAPCSGEALRTSERHTSRLVSSHERNTLQQRQIKLLESALQAARPNGHVVYSTCS
CEEEEECCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCEEEEEEC
LAPEEDEAVLDALLKRYPEQIQIMSIPTSVPIEAPGLLAAGSQHYDPSIAKALRLWPHLY
CCCCCHHHHHHHHHHHCCCCEEEEECCCCCCCCCCCCEECCCCCCCHHHHHHHHHHHHHH
NTAGFFAALIIKRDQIATPSLERPQQTLAKAGYKAVTADEQRQILDTLHAVYGFDLGKIL
HHHHHHHHHHHHCCCCCCCCCCCHHHHHHHCCCCCCCCHHHHHHHHHHHHHHCCCHHHHH
EANGLSLWRNGKTIQAIPERWLNNFEHFPFVSAGIQVGKLSRHGFQPAHDLASRYAEQFS
HCCCCEEECCCCHHHHHHHHHHCCCCCCCCHHCCCEECCHHHCCCCCHHHHHHHHHHHHH
QQWLTINDQQIDDWLARRDLPLKTSTYAAGSIVVVRDQQQRYLGLGQIDGNSLENLLPHW
HCCCCCCHHHHHHHHHHCCCCCCCCCCCCCEEEEEECCCCHHCCCCCCCCCCHHHHCCCC
Q
C
>Mature Secondary Structure 
TRQLPRQLEAYRDLLNETELNQLLESINQPLPSGLRTNPLKASANGPQAWQQQYGWQLE
CCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCHHHHHHHHCCCCC
QVPFCPTGWQLRNEVGNLSRTVEHQMGHYYIQDAASMLPVELFELPPEAEPSVLDLTAAP
CCCCCCCCHHHHHHHHHHHHHHHHHHCHHHHHHHHHHCCHHHHCCCCCCCCCEEEEECCC
GGKTTHIISQLQDRGLVVANDSNLQRIAGLKGNIQRWGSTSAVITNQPGERMGRWLPEQF
CCCHHHHHHHHHHCCEEEECCCCHHHHHCCCCCHHHCCCCCEEEECCCHHHHHCCCCHHC
DYVLLDAPCSGEALRTSERHTSRLVSSHERNTLQQRQIKLLESALQAARPNGHVVYSTCS
CEEEEECCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCEEEEEEC
LAPEEDEAVLDALLKRYPEQIQIMSIPTSVPIEAPGLLAAGSQHYDPSIAKALRLWPHLY
CCCCCHHHHHHHHHHHCCCCEEEEECCCCCCCCCCCCEECCCCCCCHHHHHHHHHHHHHH
NTAGFFAALIIKRDQIATPSLERPQQTLAKAGYKAVTADEQRQILDTLHAVYGFDLGKIL
HHHHHHHHHHHHCCCCCCCCCCCHHHHHHHCCCCCCCCHHHHHHHHHHHHHHCCCHHHHH
EANGLSLWRNGKTIQAIPERWLNNFEHFPFVSAGIQVGKLSRHGFQPAHDLASRYAEQFS
HCCCCEEECCCCHHHHHHHHHHCCCCCCCCHHCCCEECCHHHCCCCCHHHHHHHHHHHHH
QQWLTINDQQIDDWLARRDLPLKTSTYAAGSIVVVRDQQQRYLGLGQIDGNSLENLLPHW
HCCCCCCHHHHHHHHHHCCCCCCCCCCCCCEEEEEECCCCHHCCCCCCCCCCHHHHCCCC
Q
C

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA