Definition Prochlorococcus marinus str. MIT 9301, complete genome.
Accession NC_009091
Length 1,641,879

Click here to switch to the map view.

The map label for this gene is nblS [H]

Identifier: 126696865

GI number: 126696865

Start: 1294533

End: 1296599

Strand: Direct

Name: nblS [H]

Synonym: P9301_15271

Alternate gene names: 126696865

Gene position: 1294533-1296599 (Clockwise)

Preceding gene: 126696864

Following gene: 126696868

Centisome position: 78.84

GC content: 34.93

Gene sequence:

>2067_bases
ATGGTGGATACCAATAATCAAGAAAATAGAAAATACAATATCACTGATAACGAAGTTATGGATAATAACTATTGGATTAA
TGGAATCCTTGCTTGGTGGAGTGGGTTTAGTTTAAGAACAAAGTTGTTAGCCATAGCAACTCTTGTCGTGAGCCTCCTAA
TGACAGGAATAACTTTTTTTGCTTTAAATAGTATTCAAAGAGATGCTGGAATGAACGATACTAGATATGCTCGAGATCTT
GGCTTATTGTTATCTGGGAATGTTACAGAATTAGTTGCGAATAACCAGAAAAAAGAAATTTCAAATGTAGCTGAAAAGTT
TTGGAGGTCAAGTCGAAACCTGCGCTACATATTCTTTACTGATGCTGAAGATATTGTTCAACTTGGGATACCGATCAGTG
CGACACCGACAAGCTCAGACAGTCAGTTCCAGCTCACTAGAAGATTAAAATTGCCCTCAGAATTAAAGAAAAGACCACAA
TTCCCTCTGGTTAGACAGCATGCCACTCCTCAAGGTCAAGTAACAGATGTATTTGTCCCAATGTTGTGGAAGGGCAAATA
TCTTGGAACGTTAGCTTTGGGAGTCACCCCTAATAAAAAAGCACTAGCAAGTGCTGCTTTAACTAGAGAAGTAACCATTG
CAGTTTTTATCTCCATTTGGGTTTTAGTCATACTCGGAGCTGTATTTAACGCTTTAACAATTACTAGACCCGTAAGAGAG
TTAGTAAGAGGTGTGAGAGAAATCTCAAGAGGTAACTTTAAGTCCAGAATTTCTTTACCTATGACAGGTGATCTAGGAGA
ACTCTTAAATGGATTTAACCGAATGGCCACACAGTTAGAAAATTATGATGAAGCTAACATAGAAGAACTAAAAGCAGCAC
AAATCAAACAGCAATCGCTAATTGCTACAATGGCTGATGGTGCCATATTATTGGACTCAAAAGGTAAGATAGTACTTACT
AATCCAACATCAAAGAGATTATTTCGCTGGGAAGGAAGATTCTTAGAAGGTAAATATTTTTTAAATGAAATCCCCGAGAT
TTTATCTAATGATTTACATACTAATATAGAATCTATTTTAAACAGGGAAAAAGAAAAGGACGATTTAAGATTCAGTTTAG
GAGAACCAGCAAGAACCTTAAGGATTGTCTTACAATCAGTTTTAGATACAAATAAAGTTGAATTAAAAGGAATTGCTGTA
ACTATCCAAGATTTAACTAGGGAAGTTGAACTTAACGCTGCACAAAATAGATTTATTAGTAATGTTTCTCACGAATTAAG
GACACCACTTTTTAATATCAAAAGTTATGTAGAGACCTTACATGATTTAAAAGATCAGCTTTCTGATGAAGAACAAATAG
AATTTTTAGGAATTGCAAATTCAGAGACTGATAGGTTAACAAGGCTGGTAAATGATGTATTAGATTTATCAAGATTGGAG
TCTGGAAAAATTGTTCAGCTAGAGCAAATAGACATAAAACCAGCAATAGAACAAACTCTTAGAAATTATAGACTTAATGC
TACAGAAAAAAATGTTTCATTAGCTCATGAAATAGAGGAAACTATACCGCCGATTCTTGGAAATTTTGATTTGCTTTTAC
AGGTTTTTGATAATTTACTGGGTAATGGTTTGAAATTCAGTCCAAAAAATAGCTCCTTAATTATAAGAGCTTATACTTGG
CCGGATTCCTGTCCTGCCTTCCCTCCAAATATTAAAAATAATGCAGCTCCCCAATGTGAATTAGTTTCCCCACTACCAAA
AGTAAGAATTGAAATTGCTGATACTGGTTCAGGAATATCTCAGGCTGATCAAGAAAAGATATTTGATCGTTTTTATAGAG
TAGAGAATTCCGTCCATACTGAGCAAGGTACCGGTTTAGGTTTATCTATAGTGCGGGGAATAATTGAAAAACATGGTGGT
GAGATTCGTATGGCTAGTGAATTAGGAGTCGGAACAACTTTCTGGTTTGATTTATCTCTAGCACAATCTGATAAAGACGA
ATTGTTGACAAAAGCTCTTCATAATTCGGATTCTTTTTCAGGTTCTGAAATAAAAGAAATTATCTAA

Upstream 100 bases:

>100_bases
GCATACAAAAATTTAAAAGAAATTGATTTTGAAGGTATTTACTTCAGAAATGACATAGGTCATCAAGTCAGAAAAAACTT
TTCCAAGGAGAATTAAGCTC

Downstream 100 bases:

>100_bases
TTTTTATCTAATCCTTTAAAAACATTTTGAACATTTTGATCAGGTACAACTCTATGAGGGGCACCACTAAATATTTGTTC
AAAATTAGAAAAAGAATCTT

Product: two-component sensor histidine kinase

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 688; Mature: 688

Protein sequence:

>688_residues
MVDTNNQENRKYNITDNEVMDNNYWINGILAWWSGFSLRTKLLAIATLVVSLLMTGITFFALNSIQRDAGMNDTRYARDL
GLLLSGNVTELVANNQKKEISNVAEKFWRSSRNLRYIFFTDAEDIVQLGIPISATPTSSDSQFQLTRRLKLPSELKKRPQ
FPLVRQHATPQGQVTDVFVPMLWKGKYLGTLALGVTPNKKALASAALTREVTIAVFISIWVLVILGAVFNALTITRPVRE
LVRGVREISRGNFKSRISLPMTGDLGELLNGFNRMATQLENYDEANIEELKAAQIKQQSLIATMADGAILLDSKGKIVLT
NPTSKRLFRWEGRFLEGKYFLNEIPEILSNDLHTNIESILNREKEKDDLRFSLGEPARTLRIVLQSVLDTNKVELKGIAV
TIQDLTREVELNAAQNRFISNVSHELRTPLFNIKSYVETLHDLKDQLSDEEQIEFLGIANSETDRLTRLVNDVLDLSRLE
SGKIVQLEQIDIKPAIEQTLRNYRLNATEKNVSLAHEIEETIPPILGNFDLLLQVFDNLLGNGLKFSPKNSSLIIRAYTW
PDSCPAFPPNIKNNAAPQCELVSPLPKVRIEIADTGSGISQADQEKIFDRFYRVENSVHTEQGTGLGLSIVRGIIEKHGG
EIRMASELGVGTTFWFDLSLAQSDKDELLTKALHNSDSFSGSEIKEII

Sequences:

>Translated_688_residues
MVDTNNQENRKYNITDNEVMDNNYWINGILAWWSGFSLRTKLLAIATLVVSLLMTGITFFALNSIQRDAGMNDTRYARDL
GLLLSGNVTELVANNQKKEISNVAEKFWRSSRNLRYIFFTDAEDIVQLGIPISATPTSSDSQFQLTRRLKLPSELKKRPQ
FPLVRQHATPQGQVTDVFVPMLWKGKYLGTLALGVTPNKKALASAALTREVTIAVFISIWVLVILGAVFNALTITRPVRE
LVRGVREISRGNFKSRISLPMTGDLGELLNGFNRMATQLENYDEANIEELKAAQIKQQSLIATMADGAILLDSKGKIVLT
NPTSKRLFRWEGRFLEGKYFLNEIPEILSNDLHTNIESILNREKEKDDLRFSLGEPARTLRIVLQSVLDTNKVELKGIAV
TIQDLTREVELNAAQNRFISNVSHELRTPLFNIKSYVETLHDLKDQLSDEEQIEFLGIANSETDRLTRLVNDVLDLSRLE
SGKIVQLEQIDIKPAIEQTLRNYRLNATEKNVSLAHEIEETIPPILGNFDLLLQVFDNLLGNGLKFSPKNSSLIIRAYTW
PDSCPAFPPNIKNNAAPQCELVSPLPKVRIEIADTGSGISQADQEKIFDRFYRVENSVHTEQGTGLGLSIVRGIIEKHGG
EIRMASELGVGTTFWFDLSLAQSDKDELLTKALHNSDSFSGSEIKEII
>Mature_688_residues
MVDTNNQENRKYNITDNEVMDNNYWINGILAWWSGFSLRTKLLAIATLVVSLLMTGITFFALNSIQRDAGMNDTRYARDL
GLLLSGNVTELVANNQKKEISNVAEKFWRSSRNLRYIFFTDAEDIVQLGIPISATPTSSDSQFQLTRRLKLPSELKKRPQ
FPLVRQHATPQGQVTDVFVPMLWKGKYLGTLALGVTPNKKALASAALTREVTIAVFISIWVLVILGAVFNALTITRPVRE
LVRGVREISRGNFKSRISLPMTGDLGELLNGFNRMATQLENYDEANIEELKAAQIKQQSLIATMADGAILLDSKGKIVLT
NPTSKRLFRWEGRFLEGKYFLNEIPEILSNDLHTNIESILNREKEKDDLRFSLGEPARTLRIVLQSVLDTNKVELKGIAV
TIQDLTREVELNAAQNRFISNVSHELRTPLFNIKSYVETLHDLKDQLSDEEQIEFLGIANSETDRLTRLVNDVLDLSRLE
SGKIVQLEQIDIKPAIEQTLRNYRLNATEKNVSLAHEIEETIPPILGNFDLLLQVFDNLLGNGLKFSPKNSSLIIRAYTW
PDSCPAFPPNIKNNAAPQCELVSPLPKVRIEIADTGSGISQADQEKIFDRFYRVENSVHTEQGTGLGLSIVRGIIEKHGG
EIRMASELGVGTTFWFDLSLAQSDKDELLTKALHNSDSFSGSEIKEII

Specific function: Member Of The Two-Component Regulatory System Atos/Atoc; May Activate Atoc By Phosphorylation. [C]

COG id: COG0642

COG function: function code T; Signal transduction histidine kinase

Gene ontology:

Cell location: Cell membrane; Multi-pass membrane protein (Potential) [H]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 PAS (PER-ARNT-SIM) domain [H]

Homologues:

Organism=Escherichia coli, GI1788549, Length=411, Percent_Identity=25.7907542579075, Blast_Score=120, Evalue=3e-28,
Organism=Escherichia coli, GI1788713, Length=252, Percent_Identity=28.5714285714286, Blast_Score=104, Evalue=2e-23,
Organism=Escherichia coli, GI1789149, Length=268, Percent_Identity=28.7313432835821, Blast_Score=103, Evalue=3e-23,
Organism=Escherichia coli, GI1788393, Length=285, Percent_Identity=28.4210526315789, Blast_Score=102, Evalue=1e-22,
Organism=Escherichia coli, GI87082128, Length=313, Percent_Identity=25.8785942492013, Blast_Score=95, Evalue=1e-20,
Organism=Escherichia coli, GI1786600, Length=263, Percent_Identity=25.8555133079848, Blast_Score=92, Evalue=1e-19,
Organism=Escherichia coli, GI87081816, Length=251, Percent_Identity=28.2868525896414, Blast_Score=83, Evalue=6e-17,
Organism=Escherichia coli, GI1786783, Length=272, Percent_Identity=23.5294117647059, Blast_Score=80, Evalue=3e-16,
Organism=Escherichia coli, GI48994928, Length=248, Percent_Identity=29.0322580645161, Blast_Score=80, Evalue=5e-16,
Organism=Escherichia coli, GI1790346, Length=231, Percent_Identity=26.8398268398268, Blast_Score=80, Evalue=6e-16,
Organism=Escherichia coli, GI1788279, Length=226, Percent_Identity=26.5486725663717, Blast_Score=69, Evalue=8e-13,
Organism=Escherichia coli, GI1786912, Length=261, Percent_Identity=26.0536398467433, Blast_Score=64, Evalue=3e-11,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR003594
- InterPro:   IPR003660
- InterPro:   IPR000014
- InterPro:   IPR013767
- InterPro:   IPR004358
- InterPro:   IPR003661
- InterPro:   IPR005467
- InterPro:   IPR009082 [H]

Pfam domain/function: PF00672 HAMP; PF02518 HATPase_c; PF00512 HisKA; PF00989 PAS [H]

EC number: =2.7.13.3 [H]

Molecular weight: Translated: 77282; Mature: 77282

Theoretical pI: Translated: 5.82; Mature: 5.82

Prosite motif: PS50885 HAMP ; PS50109 HIS_KIN

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.3 %Cys     (Translated Protein)
1.3 %Met     (Translated Protein)
1.6 %Cys+Met (Translated Protein)
0.3 %Cys     (Mature Protein)
1.3 %Met     (Mature Protein)
1.6 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MVDTNNQENRKYNITDNEVMDNNYWINGILAWWSGFSLRTKLLAIATLVVSLLMTGITFF
CCCCCCCCCCEECCCCCEEECCCCEEHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHH
ALNSIQRDAGMNDTRYARDLGLLLSGNVTELVANNQKKEISNVAEKFWRSSRNLRYIFFT
HHHHHHHHCCCCCHHHHHHHHHHCCCCHHHHHHCCCHHHHHHHHHHHHHCCCCEEEEEEE
DAEDIVQLGIPISATPTSSDSQFQLTRRLKLPSELKKRPQFPLVRQHATPQGQVTDVFVP
CHHHHHHHCCCCCCCCCCCCCHHHHHHHHCCCHHHHHCCCCCCHHCCCCCCCCCHHHHHH
MLWKGKYLGTLALGVTPNKKALASAALTREVTIAVFISIWVLVILGAVFNALTITRPVRE
HHHCCCEEEEEEEECCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
LVRGVREISRGNFKSRISLPMTGDLGELLNGFNRMATQLENYDEANIEELKAAQIKQQSL
HHHHHHHHHCCCCCCEEECCCCCCHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHH
IATMADGAILLDSKGKIVLTNPTSKRLFRWEGRFLEGKYFLNEIPEILSNDLHTNIESIL
HHHHCCCEEEEECCCCEEEECCCCCCCEEECCCEECCHHHHHHHHHHHHHHHHHHHHHHH
NREKEKDDLRFSLGEPARTLRIVLQSVLDTNKVELKGIAVTIQDLTREVELNAAQNRFIS
CCCCCCCCCEEECCCHHHHHHHHHHHHHCCCCEEEEEEEEEHHHHHHHHHCCHHHHHHHH
NVSHELRTPLFNIKSYVETLHDLKDQLSDEEQIEFLGIANSETDRLTRLVNDVLDLSRLE
HHHHHHHCHHHHHHHHHHHHHHHHHHCCCCCCEEEEEECCCCHHHHHHHHHHHHHHHHCC
SGKIVQLEQIDIKPAIEQTLRNYRLNATEKNVSLAHEIEETIPPILGNFDLLLQVFDNLL
CCCEEEEEECCCCHHHHHHHHHCCCCCCCCCHHHHHHHHHHCCHHHCCHHHHHHHHHHHH
GNGLKFSPKNSSLIIRAYTWPDSCPAFPPNIKNNAAPQCELVSPLPKVRIEIADTGSGIS
CCCCEECCCCCEEEEEEEECCCCCCCCCCCCCCCCCCCCEECCCCCCEEEEEECCCCCCC
QADQEKIFDRFYRVENSVHTEQGTGLGLSIVRGIIEKHGGEIRMASELGVGTTFWFDLSL
HHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHCCCCEEEEHHCCCCEEEEEEEEC
AQSDKDELLTKALHNSDSFSGSEIKEII
CCCCHHHHHHHHHHCCCCCCCHHHHHCC
>Mature Secondary Structure
MVDTNNQENRKYNITDNEVMDNNYWINGILAWWSGFSLRTKLLAIATLVVSLLMTGITFF
CCCCCCCCCCEECCCCCEEECCCCEEHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHH
ALNSIQRDAGMNDTRYARDLGLLLSGNVTELVANNQKKEISNVAEKFWRSSRNLRYIFFT
HHHHHHHHCCCCCHHHHHHHHHHCCCCHHHHHHCCCHHHHHHHHHHHHHCCCCEEEEEEE
DAEDIVQLGIPISATPTSSDSQFQLTRRLKLPSELKKRPQFPLVRQHATPQGQVTDVFVP
CHHHHHHHCCCCCCCCCCCCCHHHHHHHHCCCHHHHHCCCCCCHHCCCCCCCCCHHHHHH
MLWKGKYLGTLALGVTPNKKALASAALTREVTIAVFISIWVLVILGAVFNALTITRPVRE
HHHCCCEEEEEEEECCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
LVRGVREISRGNFKSRISLPMTGDLGELLNGFNRMATQLENYDEANIEELKAAQIKQQSL
HHHHHHHHHCCCCCCEEECCCCCCHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHH
IATMADGAILLDSKGKIVLTNPTSKRLFRWEGRFLEGKYFLNEIPEILSNDLHTNIESIL
HHHHCCCEEEEECCCCEEEECCCCCCCEEECCCEECCHHHHHHHHHHHHHHHHHHHHHHH
NREKEKDDLRFSLGEPARTLRIVLQSVLDTNKVELKGIAVTIQDLTREVELNAAQNRFIS
CCCCCCCCCEEECCCHHHHHHHHHHHHHCCCCEEEEEEEEEHHHHHHHHHCCHHHHHHHH
NVSHELRTPLFNIKSYVETLHDLKDQLSDEEQIEFLGIANSETDRLTRLVNDVLDLSRLE
HHHHHHHCHHHHHHHHHHHHHHHHHHCCCCCCEEEEEECCCCHHHHHHHHHHHHHHHHCC
SGKIVQLEQIDIKPAIEQTLRNYRLNATEKNVSLAHEIEETIPPILGNFDLLLQVFDNLL
CCCEEEEEECCCCHHHHHHHHHCCCCCCCCCHHHHHHHHHHCCHHHCCHHHHHHHHHHHH
GNGLKFSPKNSSLIIRAYTWPDSCPAFPPNIKNNAAPQCELVSPLPKVRIEIADTGSGIS
CCCCEECCCCCEEEEEEEECCCCCCCCCCCCCCCCCCCCEECCCCCCEEEEEECCCCCCC
QADQEKIFDRFYRVENSVHTEQGTGLGLSIVRGIIEKHGGEIRMASELGVGTTFWFDLSL
HHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHCCCCEEEEHHCCCCEEEEEEEEC
AQSDKDELLTKALHNSDSFSGSEIKEII
CCCCHHHHHHHHHHCCCCCCCHHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 8535519; 8905231; 3141423 [H]