The gene/protein map for NC_012578 is currently unavailable.
Definition Vibrio cholerae M66-2 chromosome I, complete genome.
Accession NC_012578
Length 2,892,523

Click here to switch to the map view.

The map label for this gene is sun

Identifier: 227080281

GI number: 227080281

Start: 41997

End: 43301

Strand: Reverse

Name: sun

Synonym: VCM66_0044

Alternate gene names: 227080281

Gene position: 43301-41997 (Counterclockwise)

Preceding gene: 227080282

Following gene: 227080280

Centisome position: 1.5

GC content: 54.41

Gene sequence:

>1305_bases
TTGGCTTTTTGTTTAGGTTTTATTATGAATGTTCGCGCCGCTGCTGCGTCGGCTCTTTACCAAGTGGTTGATTTAGGGCA
CTCACTGTCCAATGCTTTGCCTGCGGCTCAGCAGCAAATTCGCCCACGTGATCACGCCCTGCTGCAAGAGATCTGCTATG
GCGTTTTGCGCCAATTGCCGCGTTTGGAATCCATCAGCCAAGCTCTGATGGGAAAACCGTTGAAAGGCAAACAACGCGTA
TTCCACTTCCTGATCCTCGTCGGCTTATACCAACTGAGCTTTATGCGCATTCCCGCACATGCTGCGGTAGGGGAAACCGT
CGAAGGCGCGCAAGATTTGAAAGGCCCTCGTCTGCGCGGCTTGATCAATGCGGTGCTGCGTAACTATCAGCGTGACCAAG
AAGGCTTAGATGCTCAAGCCACCAGCCATGACGCAGGGCGCTACGGCCATCCGGGCTGGTTATTGAAATTGCTCAAAGAG
AGCTACCCAGAGCAGTGGCAACAAATTGTTGAAGCCAACAACAGCAAAGCGCCGATGTGGCTACGCGTCAATCATCAACA
CCATACTCGTGCTGAGTATCAAGCCCTGCTCGAACAAGCTGGCATCGTCACTACGCCTCATGCGCAAGCCGAAGATGCGC
TGTGCTTAGAAACGCCTTGCGATGTACACCAACTGCCGGGTTTCGCTGAAGGTTGGGTTTCAGTACAAGATGCCGCTGCG
CAGTTAGCACTGACTTACCTTGCACCGCAAGCAGGAGAGCTGATTTTAGATTGCTGCGCTGCCCCTGGTGGCAAAACTGC
GCACATCTTGGAGCGCACACCAGAGAGCCAAGTCGTTGCGATTGATTGTGATGAAACTCGCCTCAAACGCGTGCGAGAAA
ACCTGCAGCGTTTAGAGCTCACTGCGCAAGTGATTTGTGGCGATGCGCGTTACCCGCAACAGTGGTGGCAAGGCGAACAG
TTTGATCGCATCTTGCTGGATGCACCTTGCTCGGCGACCGGCGTGATTCGCCGCCATCCCGACATCAAATGGCTGCGCCG
CGCAGACGATATCGCGGCATTAGCCGAGCTACAGCGCGAAATTTTGGATGCGATGTGGCAACAACTCAAACCCGGTGGTA
GTTTGGTGTACGCAACGTGCTCGATCACACCACAAGAAAACCGCCTACAGGTCAAAGCGTTCCTTGAACGCACGCCAGAT
GCGCGCTTAGTGGGTTCCGATCCCGCGCAGCCCGGCCGCCAAATCCTTCCCGGAGAGGAAGCGATGGACGGTTTCTATTA
CGCCGTATTAAGCAAACAACACTGA

Upstream 100 bases:

>100_bases
GCCTTGCCAGTACAAGATATTCTCAATGCGCGTGCCGACTGGTTTAGTGTCGGTTCCCAACTCAGTTAATCCTGAACCCT
AGCCTATGGATGGCTAGGGT

Downstream 100 bases:

>100_bases
TTCGGTCAACCAAGGTGAGCCACAACTCACCTTGGGCGTGAGCAAACAAAGAGAACAAGTTATGAAAATCATCATTCTTG
GTGCAGGACAAGTCGGCGGT

Product: sun protein

Products: NA

Alternate protein names: 16S rRNA m5C967 methyltransferase; rRNA (cytosine-C(5)-)-methyltransferase rsmB

Number of amino acids: Translated: 434; Mature: 433

Protein sequence:

>434_residues
MAFCLGFIMNVRAAAASALYQVVDLGHSLSNALPAAQQQIRPRDHALLQEICYGVLRQLPRLESISQALMGKPLKGKQRV
FHFLILVGLYQLSFMRIPAHAAVGETVEGAQDLKGPRLRGLINAVLRNYQRDQEGLDAQATSHDAGRYGHPGWLLKLLKE
SYPEQWQQIVEANNSKAPMWLRVNHQHHTRAEYQALLEQAGIVTTPHAQAEDALCLETPCDVHQLPGFAEGWVSVQDAAA
QLALTYLAPQAGELILDCCAAPGGKTAHILERTPESQVVAIDCDETRLKRVRENLQRLELTAQVICGDARYPQQWWQGEQ
FDRILLDAPCSATGVIRRHPDIKWLRRADDIAALAELQREILDAMWQQLKPGGSLVYATCSITPQENRLQVKAFLERTPD
ARLVGSDPAQPGRQILPGEEAMDGFYYAVLSKQH

Sequences:

>Translated_434_residues
MAFCLGFIMNVRAAAASALYQVVDLGHSLSNALPAAQQQIRPRDHALLQEICYGVLRQLPRLESISQALMGKPLKGKQRV
FHFLILVGLYQLSFMRIPAHAAVGETVEGAQDLKGPRLRGLINAVLRNYQRDQEGLDAQATSHDAGRYGHPGWLLKLLKE
SYPEQWQQIVEANNSKAPMWLRVNHQHHTRAEYQALLEQAGIVTTPHAQAEDALCLETPCDVHQLPGFAEGWVSVQDAAA
QLALTYLAPQAGELILDCCAAPGGKTAHILERTPESQVVAIDCDETRLKRVRENLQRLELTAQVICGDARYPQQWWQGEQ
FDRILLDAPCSATGVIRRHPDIKWLRRADDIAALAELQREILDAMWQQLKPGGSLVYATCSITPQENRLQVKAFLERTPD
ARLVGSDPAQPGRQILPGEEAMDGFYYAVLSKQH
>Mature_433_residues
AFCLGFIMNVRAAAASALYQVVDLGHSLSNALPAAQQQIRPRDHALLQEICYGVLRQLPRLESISQALMGKPLKGKQRVF
HFLILVGLYQLSFMRIPAHAAVGETVEGAQDLKGPRLRGLINAVLRNYQRDQEGLDAQATSHDAGRYGHPGWLLKLLKES
YPEQWQQIVEANNSKAPMWLRVNHQHHTRAEYQALLEQAGIVTTPHAQAEDALCLETPCDVHQLPGFAEGWVSVQDAAAQ
LALTYLAPQAGELILDCCAAPGGKTAHILERTPESQVVAIDCDETRLKRVRENLQRLELTAQVICGDARYPQQWWQGEQF
DRILLDAPCSATGVIRRHPDIKWLRRADDIAALAELQREILDAMWQQLKPGGSLVYATCSITPQENRLQVKAFLERTPDA
RLVGSDPAQPGRQILPGEEAMDGFYYAVLSKQH

Specific function: Specifically methylates the cytosine at position 967 (m5C967) of 16S rRNA

COG id: COG0144

COG function: function code J; tRNA and rRNA cytosine-C5-methylases

Gene ontology:

Cell location: Cytoplasm (Potential)

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the methyltransferase superfamily. RsmB/NOP family

Homologues:

Organism=Homo sapiens, GI76150625, Length=312, Percent_Identity=34.2948717948718, Blast_Score=136, Evalue=5e-32,
Organism=Homo sapiens, GI76150623, Length=312, Percent_Identity=34.2948717948718, Blast_Score=136, Evalue=5e-32,
Organism=Homo sapiens, GI32698918, Length=190, Percent_Identity=35.2631578947368, Blast_Score=102, Evalue=5e-22,
Organism=Homo sapiens, GI301336155, Length=320, Percent_Identity=27.8125, Blast_Score=81, Evalue=2e-15,
Organism=Homo sapiens, GI39995082, Length=207, Percent_Identity=31.8840579710145, Blast_Score=77, Evalue=4e-14,
Organism=Homo sapiens, GI11545785, Length=199, Percent_Identity=30.6532663316583, Blast_Score=76, Evalue=7e-14,
Organism=Homo sapiens, GI40316918, Length=190, Percent_Identity=29.4736842105263, Blast_Score=76, Evalue=8e-14,
Organism=Homo sapiens, GI270288818, Length=239, Percent_Identity=29.7071129707113, Blast_Score=71, Evalue=2e-12,
Organism=Homo sapiens, GI270288816, Length=239, Percent_Identity=29.7071129707113, Blast_Score=70, Evalue=3e-12,
Organism=Homo sapiens, GI8922322, Length=239, Percent_Identity=29.7071129707113, Blast_Score=70, Evalue=3e-12,
Organism=Homo sapiens, GI23199998, Length=239, Percent_Identity=29.7071129707113, Blast_Score=70, Evalue=3e-12,
Organism=Escherichia coli, GI2367212, Length=425, Percent_Identity=62.1176470588235, Blast_Score=531, Evalue=1e-152,
Organism=Escherichia coli, GI87081985, Length=236, Percent_Identity=31.3559322033898, Blast_Score=98, Evalue=8e-22,
Organism=Caenorhabditis elegans, GI17536757, Length=314, Percent_Identity=30.5732484076433, Blast_Score=129, Evalue=2e-30,
Organism=Caenorhabditis elegans, GI25143471, Length=196, Percent_Identity=35.2040816326531, Blast_Score=92, Evalue=6e-19,
Organism=Caenorhabditis elegans, GI17509941, Length=194, Percent_Identity=27.8350515463918, Blast_Score=65, Evalue=5e-11,
Organism=Saccharomyces cerevisiae, GI6324268, Length=312, Percent_Identity=29.4871794871795, Blast_Score=118, Evalue=1e-27,
Organism=Saccharomyces cerevisiae, GI6319447, Length=203, Percent_Identity=34.4827586206897, Blast_Score=87, Evalue=4e-18,
Organism=Drosophila melanogaster, GI22024126, Length=312, Percent_Identity=29.1666666666667, Blast_Score=119, Evalue=6e-27,
Organism=Drosophila melanogaster, GI21356513, Length=203, Percent_Identity=34.4827586206897, Blast_Score=92, Evalue=6e-19,
Organism=Drosophila melanogaster, GI24668781, Length=203, Percent_Identity=34.4827586206897, Blast_Score=92, Evalue=8e-19,
Organism=Drosophila melanogaster, GI19920494, Length=164, Percent_Identity=33.5365853658537, Blast_Score=88, Evalue=9e-18,
Organism=Drosophila melanogaster, GI21355201, Length=208, Percent_Identity=29.8076923076923, Blast_Score=81, Evalue=1e-15,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): RSMB_VIBCH (Q9KVU5)

Other databases:

- EMBL:   AE003852
- PIR:   G82372
- RefSeq:   NP_229703.1
- ProteinModelPortal:   Q9KVU5
- SMR:   Q9KVU5
- GeneID:   2614440
- GenomeReviews:   AE003852_GR
- KEGG:   vch:VC0044
- TIGR:   VC_0044
- HOGENOM:   HBG726909
- OMA:   ANNAHPP
- ProtClustDB:   PRK10901
- GO:   GO:0005737
- InterPro:   IPR001678
- InterPro:   IPR018314
- InterPro:   IPR006027
- InterPro:   IPR004573
- Gene3D:   G3DSA:1.10.940.10
- TIGRFAMs:   TIGR00563

Pfam domain/function: PF01189 Nol1_Nop2_Fmu; PF01029 NusB; SSF48013 NusB_RsmB_TIM44

EC number: =2.1.1.176

Molecular weight: Translated: 48341; Mature: 48210

Theoretical pI: Translated: 6.74; Mature: 6.74

Prosite motif: PS01153 NOL1_NOP2_SUN

Important sites: ACT_SITE 380-380 BINDING 282-282 BINDING 308-308 BINDING 327-327

Signals:

None

Transmembrane regions:

None

Cys/Met content:

2.3 %Cys     (Translated Protein)
1.6 %Met     (Translated Protein)
3.9 %Cys+Met (Translated Protein)
2.3 %Cys     (Mature Protein)
1.4 %Met     (Mature Protein)
3.7 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MAFCLGFIMNVRAAAASALYQVVDLGHSLSNALPAAQQQIRPRDHALLQEICYGVLRQLP
CHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCHHHHHHCCCHHHHHHHHHHHHHHHHCC
RLESISQALMGKPLKGKQRVFHFLILVGLYQLSFMRIPAHAAVGETVEGAQDLKGPRLRG
CHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHCCCHHHHCCHHHHHHHCCCHHHHH
LINAVLRNYQRDQEGLDAQATSHDAGRYGHPGWLLKLLKESYPEQWQQIVEANNSKAPMW
HHHHHHHHHHHHHCCCCCCCCCCCCCCCCCHHHHHHHHHHHCHHHHHHHHHCCCCCCCEE
LRVNHQHHTRAEYQALLEQAGIVTTPHAQAEDALCLETPCDVHQLPGFAEGWVSVQDAAA
EEECCCHHHHHHHHHHHHHCCCEECCCCCCCCCEEECCCCCHHHCCCHHHHHHHHHHHHH
QLALTYLAPQAGELILDCCAAPGGKTAHILERTPESQVVAIDCDETRLKRVRENLQRLEL
HHHHHHHCCCHHHHHHHHHCCCCCCEEHHHHCCCCCCEEEEECCHHHHHHHHHHHHHHHH
TAQVICGDARYPQQWWQGEQFDRILLDAPCSATGVIRRHPDIKWLRRADDIAALAELQRE
HHHHHCCCCCCCHHHCCCCCCCHHEEECCCCCCCHHHCCCCHHHHHHHHHHHHHHHHHHH
ILDAMWQQLKPGGSLVYATCSITPQENRLQVKAFLERTPDARLVGSDPAQPGRQILPGEE
HHHHHHHHCCCCCCEEEEEEECCCCCCHHHHHHHHHCCCCCEEECCCCCCCCCCCCCCHH
AMDGFYYAVLSKQH
HHHHHHEEEECCCC
>Mature Secondary Structure 
AFCLGFIMNVRAAAASALYQVVDLGHSLSNALPAAQQQIRPRDHALLQEICYGVLRQLP
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCHHHHHHCCCHHHHHHHHHHHHHHHHCC
RLESISQALMGKPLKGKQRVFHFLILVGLYQLSFMRIPAHAAVGETVEGAQDLKGPRLRG
CHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHCCCHHHHCCHHHHHHHCCCHHHHH
LINAVLRNYQRDQEGLDAQATSHDAGRYGHPGWLLKLLKESYPEQWQQIVEANNSKAPMW
HHHHHHHHHHHHHCCCCCCCCCCCCCCCCCHHHHHHHHHHHCHHHHHHHHHCCCCCCCEE
LRVNHQHHTRAEYQALLEQAGIVTTPHAQAEDALCLETPCDVHQLPGFAEGWVSVQDAAA
EEECCCHHHHHHHHHHHHHCCCEECCCCCCCCCEEECCCCCHHHCCCHHHHHHHHHHHHH
QLALTYLAPQAGELILDCCAAPGGKTAHILERTPESQVVAIDCDETRLKRVRENLQRLEL
HHHHHHHCCCHHHHHHHHHCCCCCCEEHHHHCCCCCCEEEEECCHHHHHHHHHHHHHHHH
TAQVICGDARYPQQWWQGEQFDRILLDAPCSATGVIRRHPDIKWLRRADDIAALAELQRE
HHHHHCCCCCCCHHHCCCCCCCHHEEECCCCCCCHHHCCCCHHHHHHHHHHHHHHHHHHH
ILDAMWQQLKPGGSLVYATCSITPQENRLQVKAFLERTPDARLVGSDPAQPGRQILPGEE
HHHHHHHHCCCCCCEEEEEEECCCCCCHHHHHHHHHCCCCCEEECCCCCCCCCCCCCCHH
AMDGFYYAVLSKQH
HHHHHHEEEECCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 10952301