Definition Prochlorococcus marinus str. MIT 9301, complete genome.
Accession NC_009091
Length 1,641,879

Click here to switch to the map view.

The map label for this gene is mraW

Identifier: 126695529

GI number: 126695529

Start: 175845

End: 176747

Strand: Reverse

Name: mraW

Synonym: P9301_01911

Alternate gene names: 126695529

Gene position: 176747-175845 (Counterclockwise)

Preceding gene: 126695532

Following gene: 126695527

Centisome position: 10.76

GC content: 32.23

Gene sequence:

>903_bases
ATGCAAACTGACCTATCTGATTCATCTTTTTTCAATCATAAATCAGTTATGACAGATGAGATTATGGCCTCATTAGAGCA
TTACCCACTTATACATAACAATCAACTTAAGGGAATAGACGCAACTTTAGGCGGAGGCGGGCACTCTTATCATTTATTGA
GAAAATATTCGGATTTAAATATAATTGGACTTGATCAAGATCCATTCGCGAGAAAATCAGCATTAAAAAAACTTGATGAG
TTTAAAAGTAGGATTGATATAAGGGCTTCAAATTTTGCGGATTTTGTACCAAAAGAAAAAGTTTCTTTTGTGATTGCAGA
TCTTGGAGTAAATAGTAACCAACTTGATGACCCTAAAAGAGGATTTAGTTTCCAAAAAGATGGTCCGCTTGATATGCGAA
TGAATCCTTTGCTTGATGTTGATGCAGAGAAATTAATTGAGGTTTTAAATGAAAAAGATCTAGCTAACCTAATCTATAAA
TATGGAGATGAGAGATTATCAAGAAAGATTGCTAGGAAAATAAAATTAGATTTGAAGGAAAATGGAAAATATTCTGGGAC
AAAAGAGTTAGCTTACTCTATTGCAGGCTGCTTCCCACCAAAACAAAGATATAAAAAAATACATCCAGCAACAAGAACAT
TTCAAGCACTAAGAATTGCTGTTAATAAAGAAATTGAAGTATTAGAAAAATTTTTGCAAGTTGTACCTGAATGGCTTTTG
CCAGGGGGTATTATTTCTGTTATTAGTTTTCATTCTCTTGAGGACAGGTTAGTTAAAAGTTGTTTTAAGAATGATCAAAG
ACTAAAAAACCTGACAAAAAAACCAATAACTCCTTCCGAAGAAGAAGTCGAACTTAATAAAAGAGCTAGAAGTGGAAAAT
TAAGAATTGCTCAATTAAATTAA

Upstream 100 bases:

>100_bases
GAAGGATGGTGAGGGCCAAAATTCACCACCATTGGTTCTGTTCTAGTCTCTAGCTGAGCCATTCGAAATTTAACTTCTAA
ACAAATCTTAGTCGAAAGTT

Downstream 100 bases:

>100_bases
AAGCCAATAATTTCTATCGTAATGATCTGATTGTATTTGTAAGAATATGAATTGCTTGTTTTATATCTTTTGAATTAGTA
CTTAATCCAATACTTAACCT

Product: S-adenosyl-methyltransferase MraW

Products: NA

Alternate protein names: 16S rRNA m(4)C1402 methyltransferase; rRNA (cytosine-N(4)-)-methyltransferase RsmH

Number of amino acids: Translated: 300; Mature: 300

Protein sequence:

>300_residues
MQTDLSDSSFFNHKSVMTDEIMASLEHYPLIHNNQLKGIDATLGGGGHSYHLLRKYSDLNIIGLDQDPFARKSALKKLDE
FKSRIDIRASNFADFVPKEKVSFVIADLGVNSNQLDDPKRGFSFQKDGPLDMRMNPLLDVDAEKLIEVLNEKDLANLIYK
YGDERLSRKIARKIKLDLKENGKYSGTKELAYSIAGCFPPKQRYKKIHPATRTFQALRIAVNKEIEVLEKFLQVVPEWLL
PGGIISVISFHSLEDRLVKSCFKNDQRLKNLTKKPITPSEEEVELNKRARSGKLRIAQLN

Sequences:

>Translated_300_residues
MQTDLSDSSFFNHKSVMTDEIMASLEHYPLIHNNQLKGIDATLGGGGHSYHLLRKYSDLNIIGLDQDPFARKSALKKLDE
FKSRIDIRASNFADFVPKEKVSFVIADLGVNSNQLDDPKRGFSFQKDGPLDMRMNPLLDVDAEKLIEVLNEKDLANLIYK
YGDERLSRKIARKIKLDLKENGKYSGTKELAYSIAGCFPPKQRYKKIHPATRTFQALRIAVNKEIEVLEKFLQVVPEWLL
PGGIISVISFHSLEDRLVKSCFKNDQRLKNLTKKPITPSEEEVELNKRARSGKLRIAQLN
>Mature_300_residues
MQTDLSDSSFFNHKSVMTDEIMASLEHYPLIHNNQLKGIDATLGGGGHSYHLLRKYSDLNIIGLDQDPFARKSALKKLDE
FKSRIDIRASNFADFVPKEKVSFVIADLGVNSNQLDDPKRGFSFQKDGPLDMRMNPLLDVDAEKLIEVLNEKDLANLIYK
YGDERLSRKIARKIKLDLKENGKYSGTKELAYSIAGCFPPKQRYKKIHPATRTFQALRIAVNKEIEVLEKFLQVVPEWLL
PGGIISVISFHSLEDRLVKSCFKNDQRLKNLTKKPITPSEEEVELNKRARSGKLRIAQLN

Specific function: Specifically methylates the N4 position of cytidine in position 1402 (C1402) of 16S rRNA

COG id: COG0275

COG function: function code M; Predicted S-adenosylmethionine-dependent methyltransferase involved in cell envelope biogenesis

Gene ontology:

Cell location: Cytoplasm

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the methyltransferase superfamily. RsmH family

Homologues:

Organism=Homo sapiens, GI165377209, Length=343, Percent_Identity=32.9446064139942, Blast_Score=153, Evalue=2e-37,
Organism=Homo sapiens, GI165377202, Length=177, Percent_Identity=34.4632768361582, Blast_Score=92, Evalue=8e-19,
Organism=Escherichia coli, GI1786270, Length=314, Percent_Identity=38.8535031847134, Blast_Score=184, Evalue=9e-48,
Organism=Drosophila melanogaster, GI62472493, Length=304, Percent_Identity=33.8815789473684, Blast_Score=134, Evalue=9e-32,
Organism=Drosophila melanogaster, GI28571637, Length=304, Percent_Identity=33.8815789473684, Blast_Score=134, Evalue=9e-32,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): RSMH_PROM0 (A3PAN9)

Other databases:

- EMBL:   CP000576
- RefSeq:   YP_001090415.1
- ProteinModelPortal:   A3PAN9
- SMR:   A3PAN9
- STRING:   A3PAN9
- GeneID:   4912849
- GenomeReviews:   CP000576_GR
- KEGG:   pmg:P9301_01911
- eggNOG:   COG0275
- HOGENOM:   HBG302779
- OMA:   PQLDDPE
- ProtClustDB:   PRK00050
- BioCyc:   PMAR167546:P9301ORF_0193-MONOMER
- GO:   GO:0005737
- HAMAP:   MF_01007
- InterPro:   IPR002903
- PANTHER:   PTHR11265
- PIRSF:   PIRSF004486
- TIGRFAMs:   TIGR00006

Pfam domain/function: PF01795 Methyltransf_5

EC number: NA

Molecular weight: Translated: 34188; Mature: 34188

Theoretical pI: Translated: 9.76; Mature: 9.76

Prosite motif: PS01048 RIBOSOMAL_S6

Important sites: BINDING 65-65 BINDING 92-92 BINDING 107-107 BINDING 114-114

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.7 %Cys     (Translated Protein)
1.7 %Met     (Translated Protein)
2.3 %Cys+Met (Translated Protein)
0.7 %Cys     (Mature Protein)
1.7 %Met     (Mature Protein)
2.3 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MQTDLSDSSFFNHKSVMTDEIMASLEHYPLIHNNQLKGIDATLGGGGHSYHLLRKYSDLN
CCCCCCCCHHHCHHHHHHHHHHHHHHHCCCEECCCCCCCEEEECCCCCHHHHHHHCCCCE
IIGLDQDPFARKSALKKLDEFKSRIDIRASNFADFVPKEKVSFVIADLGVNSNQLDDPKR
EEECCCCCHHHHHHHHHHHHHHHHHCCCCCCHHHHCCCHHHEEEEEECCCCCCCCCCHHH
GFSFQKDGPLDMRMNPLLDVDAEKLIEVLNEKDLANLIYKYGDERLSRKIARKIKLDLKE
CCCCCCCCCCCCCCCCCCCCCHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHCCHHC
NGKYSGTKELAYSIAGCFPPKQRYKKIHPATRTFQALRIAVNKEIEVLEKFLQVVPEWLL
CCCCCCHHHHHHHHHHCCCCHHHHHHHCCHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHC
PGGIISVISFHSLEDRLVKSCFKNDQRLKNLTKKPITPSEEEVELNKRARSGKLRIAQLN
CCHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHCCCCCCCHHHHHHHHHHCCCCEEEEECC
>Mature Secondary Structure
MQTDLSDSSFFNHKSVMTDEIMASLEHYPLIHNNQLKGIDATLGGGGHSYHLLRKYSDLN
CCCCCCCCHHHCHHHHHHHHHHHHHHHCCCEECCCCCCCEEEECCCCCHHHHHHHCCCCE
IIGLDQDPFARKSALKKLDEFKSRIDIRASNFADFVPKEKVSFVIADLGVNSNQLDDPKR
EEECCCCCHHHHHHHHHHHHHHHHHCCCCCCHHHHCCCHHHEEEEEECCCCCCCCCCHHH
GFSFQKDGPLDMRMNPLLDVDAEKLIEVLNEKDLANLIYKYGDERLSRKIARKIKLDLKE
CCCCCCCCCCCCCCCCCCCCCHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHCCHHC
NGKYSGTKELAYSIAGCFPPKQRYKKIHPATRTFQALRIAVNKEIEVLEKFLQVVPEWLL
CCCCCCHHHHHHHHHHCCCCHHHHHHHCCHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHC
PGGIISVISFHSLEDRLVKSCFKNDQRLKNLTKKPITPSEEEVELNKRARSGKLRIAQLN
CCHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHCCCCCCCHHHHHHHHHHCCCCEEEEECC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: NA