| Definition | Prochlorococcus marinus str. NATL1A, complete genome. |
|---|---|
| Accession | NC_008819 |
| Length | 1,864,731 |
Click here to switch to the map view.
The map label for this gene is sun [H]
Identifier: 124025193
GI number: 124025193
Start: 437072
End: 438418
Strand: Direct
Name: sun [H]
Synonym: NATL1_04801
Alternate gene names: 124025193
Gene position: 437072-438418 (Clockwise)
Preceding gene: 124025190
Following gene: 124025196
Centisome position: 23.44
GC content: 38.23
Gene sequence:
>1347_bases TTGCTTTTGAGTGAAAACCTGTCATCCATAAAAGGCTTAGATGCCAGAAAAGCTGCTTGGGAGGTTATCCAAGCCGTAGG TGGAGGTTCATTCGCAGATGTTGCTTTGGAAAGGATTTTTAATCTTTATTCCTTTAAGTCGATAGATAAAGCTTTGATAA CTGAACTTTCTTATGGTGCAATTCGCCAAAGATATTACTTGGATTGTTGGATTGATCATTTAGGGAAAGTACCCGCTAAA AAACAACCTCCTTTATTGAGATGGCTATTGCATCTTGGGCTTTATCAGGTTCTAAAAATGAAGAGAATACCTCCAGCTGC TGCAATTAACACAACTGTAGAGCTTGCGAAAACTCATCATTTAAGAAAGCTAGCCCCCGTTGTTAATGGAATCTTGCGAT CTGCTCTTAGAAGCAAAGAGAGAGGACTCTTGTTGCCTAAATCGAATAATCCAAGTTTGGAATTGGCAAAAAACGAGTCA CTTCCTGTTTGGTTTGCAGAGGAATTGATTGCTTGGAAGGGAGTCGAACATGCTCAGCAGATTGCTAAAGCATTCAACAG CGTTAGTCCTATTGATATAAGAGTGAATAAATTGCGTGCAGATTTAAAAGATGTAAAAGAACTTTTTGATACCTGCGGTA TTCAAAATCAATTAATCCCAAACTGTCCTTCCGGATTGGAGGTACGAGCTGGTATAGGTGAACCTAGACAATGGCCTGGT TATGAAGAAGGTAAATGGAGTGTTCAAGATAGATCTTCACAGTTAATTGCCCCATCATTAGGACCTCTACCTGGAGAAAA GATTCTTGATGCTTGTGCTGCACCAGGCGGAAAATCAACACATATTGCTGAATTAATTAATAATGAGGGCAATCTCTGGT CTGTTGATCGATCATCCAGAAGATCTAAAAAAATATTAGCTAACTCAGAGAGGCTTGGGACTAAATGCTTGCAAATATTG GTTGCTGATTCTAATGAGCTATTACTCAAAAAGCCAGATTGGAAAGGTTTTTTTGATCGTATATTAATAGATGCTCCATG CTCAGGATTGGGTACTCTTGCTCGCCACCCTGATGCAAGATGGAGGATGAATCAAGATAATATTCAGCAGCTTGTCGCTG TTCAAAGTCAGTTGCTTAACTCGTTAGCGCCTTTATTGAAAAATGGAGGGAAGTTGGTTTATTCCACTTGTACTATTCAC CCTGAAGAAAATTCTCATCAGATAAAAAATTTTCTTCAATCTAAGTCTGAGTTTTTATTGGAATATGAAAAACAGATCTG GCCTGGAGAGGGAGATAATGGAGATGGTTTTTATATTGCTGTTTTAAATAAATTAAAAAATCAATAA
Upstream 100 bases:
>100_bases CCTGCTATTCCTTGGAAAGTCACTGTAGTAAAAGACTTTTGGGCTTTTGAGCTATGATTATTTCGATAAACATTTTAATG TGGACTGAACTTTTAAATGA
Downstream 100 bases:
>100_bases AGGTGATGACGTGTAAACTCGATTTTTAAATAGCTTTGATCTTATTTTTGGTTTTAATGATTAATTTTATAAACTAATTA AGGAACTATGTCCAATAGCT
Product: Sun protein (Fmu protein)
Products: NA
Alternate protein names: rRNA (cytosine-C(5)-)-methyltransferase rsmB [H]
Number of amino acids: Translated: 448; Mature: 448
Protein sequence:
>448_residues MLLSENLSSIKGLDARKAAWEVIQAVGGGSFADVALERIFNLYSFKSIDKALITELSYGAIRQRYYLDCWIDHLGKVPAK KQPPLLRWLLHLGLYQVLKMKRIPPAAAINTTVELAKTHHLRKLAPVVNGILRSALRSKERGLLLPKSNNPSLELAKNES LPVWFAEELIAWKGVEHAQQIAKAFNSVSPIDIRVNKLRADLKDVKELFDTCGIQNQLIPNCPSGLEVRAGIGEPRQWPG YEEGKWSVQDRSSQLIAPSLGPLPGEKILDACAAPGGKSTHIAELINNEGNLWSVDRSSRRSKKILANSERLGTKCLQIL VADSNELLLKKPDWKGFFDRILIDAPCSGLGTLARHPDARWRMNQDNIQQLVAVQSQLLNSLAPLLKNGGKLVYSTCTIH PEENSHQIKNFLQSKSEFLLEYEKQIWPGEGDNGDGFYIAVLNKLKNQ
Sequences:
>Translated_448_residues MLLSENLSSIKGLDARKAAWEVIQAVGGGSFADVALERIFNLYSFKSIDKALITELSYGAIRQRYYLDCWIDHLGKVPAK KQPPLLRWLLHLGLYQVLKMKRIPPAAAINTTVELAKTHHLRKLAPVVNGILRSALRSKERGLLLPKSNNPSLELAKNES LPVWFAEELIAWKGVEHAQQIAKAFNSVSPIDIRVNKLRADLKDVKELFDTCGIQNQLIPNCPSGLEVRAGIGEPRQWPG YEEGKWSVQDRSSQLIAPSLGPLPGEKILDACAAPGGKSTHIAELINNEGNLWSVDRSSRRSKKILANSERLGTKCLQIL VADSNELLLKKPDWKGFFDRILIDAPCSGLGTLARHPDARWRMNQDNIQQLVAVQSQLLNSLAPLLKNGGKLVYSTCTIH PEENSHQIKNFLQSKSEFLLEYEKQIWPGEGDNGDGFYIAVLNKLKNQ >Mature_448_residues MLLSENLSSIKGLDARKAAWEVIQAVGGGSFADVALERIFNLYSFKSIDKALITELSYGAIRQRYYLDCWIDHLGKVPAK KQPPLLRWLLHLGLYQVLKMKRIPPAAAINTTVELAKTHHLRKLAPVVNGILRSALRSKERGLLLPKSNNPSLELAKNES LPVWFAEELIAWKGVEHAQQIAKAFNSVSPIDIRVNKLRADLKDVKELFDTCGIQNQLIPNCPSGLEVRAGIGEPRQWPG YEEGKWSVQDRSSQLIAPSLGPLPGEKILDACAAPGGKSTHIAELINNEGNLWSVDRSSRRSKKILANSERLGTKCLQIL VADSNELLLKKPDWKGFFDRILIDAPCSGLGTLARHPDARWRMNQDNIQQLVAVQSQLLNSLAPLLKNGGKLVYSTCTIH PEENSHQIKNFLQSKSEFLLEYEKQIWPGEGDNGDGFYIAVLNKLKNQ
Specific function: Unknown
COG id: COG0144
COG function: function code J; tRNA and rRNA cytosine-C5-methylases
Gene ontology:
Cell location: Cytoplasm (Potential) [H]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the methyltransferase superfamily. RsmB/NOP family [H]
Homologues:
Organism=Homo sapiens, GI76150625, Length=286, Percent_Identity=29.3706293706294, Blast_Score=117, Evalue=3e-26, Organism=Homo sapiens, GI76150623, Length=286, Percent_Identity=29.3706293706294, Blast_Score=117, Evalue=3e-26, Organism=Homo sapiens, GI32698918, Length=292, Percent_Identity=31.1643835616438, Blast_Score=113, Evalue=3e-25, Organism=Homo sapiens, GI39995082, Length=192, Percent_Identity=33.3333333333333, Blast_Score=96, Evalue=7e-20, Organism=Homo sapiens, GI301336155, Length=192, Percent_Identity=33.3333333333333, Blast_Score=96, Evalue=7e-20, Organism=Homo sapiens, GI8922322, Length=296, Percent_Identity=27.7027027027027, Blast_Score=94, Evalue=3e-19, Organism=Homo sapiens, GI270288818, Length=296, Percent_Identity=27.7027027027027, Blast_Score=94, Evalue=3e-19, Organism=Homo sapiens, GI270288816, Length=296, Percent_Identity=27.7027027027027, Blast_Score=94, Evalue=3e-19, Organism=Homo sapiens, GI23199998, Length=296, Percent_Identity=27.7027027027027, Blast_Score=94, Evalue=4e-19, Organism=Escherichia coli, GI2367212, Length=406, Percent_Identity=36.9458128078818, Blast_Score=205, Evalue=5e-54, Organism=Escherichia coli, GI87081985, Length=218, Percent_Identity=33.9449541284404, Blast_Score=108, Evalue=8e-25, Organism=Caenorhabditis elegans, GI17536757, Length=296, Percent_Identity=30.4054054054054, Blast_Score=122, Evalue=3e-28, Organism=Caenorhabditis elegans, GI71998419, Length=171, Percent_Identity=30.4093567251462, Blast_Score=86, Evalue=4e-17, Organism=Caenorhabditis elegans, GI115534021, Length=171, Percent_Identity=30.4093567251462, Blast_Score=86, Evalue=4e-17, Organism=Caenorhabditis elegans, GI25143471, Length=182, Percent_Identity=30.7692307692308, Blast_Score=72, Evalue=8e-13, Organism=Saccharomyces cerevisiae, GI6324268, Length=257, Percent_Identity=31.9066147859922, Blast_Score=122, Evalue=1e-28, Organism=Saccharomyces cerevisiae, GI6319447, Length=173, Percent_Identity=34.1040462427746, Blast_Score=80, Evalue=7e-16, Organism=Drosophila melanogaster, GI22024126, Length=236, Percent_Identity=31.7796610169492, Blast_Score=117, Evalue=2e-26, Organism=Drosophila melanogaster, GI24668781, Length=204, Percent_Identity=33.8235294117647, Blast_Score=94, Evalue=1e-19, Organism=Drosophila melanogaster, GI21356513, Length=204, Percent_Identity=33.8235294117647, Blast_Score=94, Evalue=2e-19, Organism=Drosophila melanogaster, GI21355201, Length=184, Percent_Identity=32.0652173913043, Blast_Score=93, Evalue=5e-19, Organism=Drosophila melanogaster, GI21356579, Length=221, Percent_Identity=26.6968325791855, Blast_Score=84, Evalue=2e-16, Organism=Drosophila melanogaster, GI19920494, Length=179, Percent_Identity=31.2849162011173, Blast_Score=66, Evalue=6e-11,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR001678 - InterPro: IPR018314 - InterPro: IPR006027 - InterPro: IPR004573 [H]
Pfam domain/function: PF01189 Nol1_Nop2_Fmu; PF01029 NusB [H]
EC number: NA
Molecular weight: Translated: 49949; Mature: 49949
Theoretical pI: Translated: 9.53; Mature: 9.53
Prosite motif: PS01153 NOL1_NOP2_SUN
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.6 %Cys (Translated Protein) 0.7 %Met (Translated Protein) 2.2 %Cys+Met (Translated Protein) 1.6 %Cys (Mature Protein) 0.7 %Met (Mature Protein) 2.2 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MLLSENLSSIKGLDARKAAWEVIQAVGGGSFADVALERIFNLYSFKSIDKALITELSYGA CCCCCCHHHHCCCCHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH IRQRYYLDCWIDHLGKVPAKKQPPLLRWLLHLGLYQVLKMKRIPPAAAINTTVELAKTHH HHHHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHH LRKLAPVVNGILRSALRSKERGLLLPKSNNPSLELAKNESLPVWFAEELIAWKGVEHAQQ HHHHHHHHHHHHHHHHHHHHCCEEEECCCCCCEEEECCCCCCHHHHHHHHHHCCHHHHHH IAKAFNSVSPIDIRVNKLRADLKDVKELFDTCGIQNQLIPNCPSGLEVRAGIGEPRQWPG HHHHHCCCCCCEEEHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCEEECCCCCCCCCCC YEEGKWSVQDRSSQLIAPSLGPLPGEKILDACAAPGGKSTHIAELINNEGNLWSVDRSSR CCCCCCCCCCCCCCEECCCCCCCCHHHHHHHHCCCCCCCHHHHHHHCCCCCEEECCCHHH RSKKILANSERLGTKCLQILVADSNELLLKKPDWKGFFDRILIDAPCSGLGTLARHPDAR HHHHHHHCCHHHHHHHHHHHHCCCCCEEEECCCCHHHHHHHHHCCCCCCHHHHHHCCCCC WRMNQDNIQQLVAVQSQLLNSLAPLLKNGGKLVYSTCTIHPEENSHQIKNFLQSKSEFLL CCCCHHHHHHHHHHHHHHHHHHHHHHHCCCEEEEEEEEECCCCCHHHHHHHHHHHHHHHH EYEKQIWPGEGDNGDGFYIAVLNKLKNQ HHHHHCCCCCCCCCCEEEEEEHHHHCCC >Mature Secondary Structure MLLSENLSSIKGLDARKAAWEVIQAVGGGSFADVALERIFNLYSFKSIDKALITELSYGA CCCCCCHHHHCCCCHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH IRQRYYLDCWIDHLGKVPAKKQPPLLRWLLHLGLYQVLKMKRIPPAAAINTTVELAKTHH HHHHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHH LRKLAPVVNGILRSALRSKERGLLLPKSNNPSLELAKNESLPVWFAEELIAWKGVEHAQQ HHHHHHHHHHHHHHHHHHHHCCEEEECCCCCCEEEECCCCCCHHHHHHHHHHCCHHHHHH IAKAFNSVSPIDIRVNKLRADLKDVKELFDTCGIQNQLIPNCPSGLEVRAGIGEPRQWPG HHHHHCCCCCCEEEHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCEEECCCCCCCCCCC YEEGKWSVQDRSSQLIAPSLGPLPGEKILDACAAPGGKSTHIAELINNEGNLWSVDRSSR CCCCCCCCCCCCCCEECCCCCCCCHHHHHHHHCCCCCCCHHHHHHHCCCCCEEECCCHHH RSKKILANSERLGTKCLQILVADSNELLLKKPDWKGFFDRILIDAPCSGLGTLARHPDAR HHHHHHHCCHHHHHHHHHHHHCCCCCEEEECCCCHHHHHHHHHCCCCCCHHHHHHCCCCC WRMNQDNIQQLVAVQSQLLNSLAPLLKNGGKLVYSTCTIHPEENSHQIKNFLQSKSEFLL CCCCHHHHHHHHHHHHHHHHHHHHHHHCCCEEEEEEEEECCCCCHHHHHHHHHHHHHHHH EYEKQIWPGEGDNGDGFYIAVLNKLKNQ HHHHHCCCCCCCCCCEEEEEEHHHHCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 8905231 [H]