| Definition | Prochlorococcus marinus str. MIT 9301, complete genome. |
|---|---|
| Accession | NC_009091 |
| Length | 1,641,879 |
Click here to switch to the map view.
The map label for this gene is nblS [H]
Identifier: 126696865
GI number: 126696865
Start: 1294533
End: 1296599
Strand: Direct
Name: nblS [H]
Synonym: P9301_15271
Alternate gene names: 126696865
Gene position: 1294533-1296599 (Clockwise)
Preceding gene: 126696864
Following gene: 126696868
Centisome position: 78.84
GC content: 34.93
Gene sequence:
>2067_bases ATGGTGGATACCAATAATCAAGAAAATAGAAAATACAATATCACTGATAACGAAGTTATGGATAATAACTATTGGATTAA TGGAATCCTTGCTTGGTGGAGTGGGTTTAGTTTAAGAACAAAGTTGTTAGCCATAGCAACTCTTGTCGTGAGCCTCCTAA TGACAGGAATAACTTTTTTTGCTTTAAATAGTATTCAAAGAGATGCTGGAATGAACGATACTAGATATGCTCGAGATCTT GGCTTATTGTTATCTGGGAATGTTACAGAATTAGTTGCGAATAACCAGAAAAAAGAAATTTCAAATGTAGCTGAAAAGTT TTGGAGGTCAAGTCGAAACCTGCGCTACATATTCTTTACTGATGCTGAAGATATTGTTCAACTTGGGATACCGATCAGTG CGACACCGACAAGCTCAGACAGTCAGTTCCAGCTCACTAGAAGATTAAAATTGCCCTCAGAATTAAAGAAAAGACCACAA TTCCCTCTGGTTAGACAGCATGCCACTCCTCAAGGTCAAGTAACAGATGTATTTGTCCCAATGTTGTGGAAGGGCAAATA TCTTGGAACGTTAGCTTTGGGAGTCACCCCTAATAAAAAAGCACTAGCAAGTGCTGCTTTAACTAGAGAAGTAACCATTG CAGTTTTTATCTCCATTTGGGTTTTAGTCATACTCGGAGCTGTATTTAACGCTTTAACAATTACTAGACCCGTAAGAGAG TTAGTAAGAGGTGTGAGAGAAATCTCAAGAGGTAACTTTAAGTCCAGAATTTCTTTACCTATGACAGGTGATCTAGGAGA ACTCTTAAATGGATTTAACCGAATGGCCACACAGTTAGAAAATTATGATGAAGCTAACATAGAAGAACTAAAAGCAGCAC AAATCAAACAGCAATCGCTAATTGCTACAATGGCTGATGGTGCCATATTATTGGACTCAAAAGGTAAGATAGTACTTACT AATCCAACATCAAAGAGATTATTTCGCTGGGAAGGAAGATTCTTAGAAGGTAAATATTTTTTAAATGAAATCCCCGAGAT TTTATCTAATGATTTACATACTAATATAGAATCTATTTTAAACAGGGAAAAAGAAAAGGACGATTTAAGATTCAGTTTAG GAGAACCAGCAAGAACCTTAAGGATTGTCTTACAATCAGTTTTAGATACAAATAAAGTTGAATTAAAAGGAATTGCTGTA ACTATCCAAGATTTAACTAGGGAAGTTGAACTTAACGCTGCACAAAATAGATTTATTAGTAATGTTTCTCACGAATTAAG GACACCACTTTTTAATATCAAAAGTTATGTAGAGACCTTACATGATTTAAAAGATCAGCTTTCTGATGAAGAACAAATAG AATTTTTAGGAATTGCAAATTCAGAGACTGATAGGTTAACAAGGCTGGTAAATGATGTATTAGATTTATCAAGATTGGAG TCTGGAAAAATTGTTCAGCTAGAGCAAATAGACATAAAACCAGCAATAGAACAAACTCTTAGAAATTATAGACTTAATGC TACAGAAAAAAATGTTTCATTAGCTCATGAAATAGAGGAAACTATACCGCCGATTCTTGGAAATTTTGATTTGCTTTTAC AGGTTTTTGATAATTTACTGGGTAATGGTTTGAAATTCAGTCCAAAAAATAGCTCCTTAATTATAAGAGCTTATACTTGG CCGGATTCCTGTCCTGCCTTCCCTCCAAATATTAAAAATAATGCAGCTCCCCAATGTGAATTAGTTTCCCCACTACCAAA AGTAAGAATTGAAATTGCTGATACTGGTTCAGGAATATCTCAGGCTGATCAAGAAAAGATATTTGATCGTTTTTATAGAG TAGAGAATTCCGTCCATACTGAGCAAGGTACCGGTTTAGGTTTATCTATAGTGCGGGGAATAATTGAAAAACATGGTGGT GAGATTCGTATGGCTAGTGAATTAGGAGTCGGAACAACTTTCTGGTTTGATTTATCTCTAGCACAATCTGATAAAGACGA ATTGTTGACAAAAGCTCTTCATAATTCGGATTCTTTTTCAGGTTCTGAAATAAAAGAAATTATCTAA
Upstream 100 bases:
>100_bases GCATACAAAAATTTAAAAGAAATTGATTTTGAAGGTATTTACTTCAGAAATGACATAGGTCATCAAGTCAGAAAAAACTT TTCCAAGGAGAATTAAGCTC
Downstream 100 bases:
>100_bases TTTTTATCTAATCCTTTAAAAACATTTTGAACATTTTGATCAGGTACAACTCTATGAGGGGCACCACTAAATATTTGTTC AAAATTAGAAAAAGAATCTT
Product: two-component sensor histidine kinase
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 688; Mature: 688
Protein sequence:
>688_residues MVDTNNQENRKYNITDNEVMDNNYWINGILAWWSGFSLRTKLLAIATLVVSLLMTGITFFALNSIQRDAGMNDTRYARDL GLLLSGNVTELVANNQKKEISNVAEKFWRSSRNLRYIFFTDAEDIVQLGIPISATPTSSDSQFQLTRRLKLPSELKKRPQ FPLVRQHATPQGQVTDVFVPMLWKGKYLGTLALGVTPNKKALASAALTREVTIAVFISIWVLVILGAVFNALTITRPVRE LVRGVREISRGNFKSRISLPMTGDLGELLNGFNRMATQLENYDEANIEELKAAQIKQQSLIATMADGAILLDSKGKIVLT NPTSKRLFRWEGRFLEGKYFLNEIPEILSNDLHTNIESILNREKEKDDLRFSLGEPARTLRIVLQSVLDTNKVELKGIAV TIQDLTREVELNAAQNRFISNVSHELRTPLFNIKSYVETLHDLKDQLSDEEQIEFLGIANSETDRLTRLVNDVLDLSRLE SGKIVQLEQIDIKPAIEQTLRNYRLNATEKNVSLAHEIEETIPPILGNFDLLLQVFDNLLGNGLKFSPKNSSLIIRAYTW PDSCPAFPPNIKNNAAPQCELVSPLPKVRIEIADTGSGISQADQEKIFDRFYRVENSVHTEQGTGLGLSIVRGIIEKHGG EIRMASELGVGTTFWFDLSLAQSDKDELLTKALHNSDSFSGSEIKEII
Sequences:
>Translated_688_residues MVDTNNQENRKYNITDNEVMDNNYWINGILAWWSGFSLRTKLLAIATLVVSLLMTGITFFALNSIQRDAGMNDTRYARDL GLLLSGNVTELVANNQKKEISNVAEKFWRSSRNLRYIFFTDAEDIVQLGIPISATPTSSDSQFQLTRRLKLPSELKKRPQ FPLVRQHATPQGQVTDVFVPMLWKGKYLGTLALGVTPNKKALASAALTREVTIAVFISIWVLVILGAVFNALTITRPVRE LVRGVREISRGNFKSRISLPMTGDLGELLNGFNRMATQLENYDEANIEELKAAQIKQQSLIATMADGAILLDSKGKIVLT NPTSKRLFRWEGRFLEGKYFLNEIPEILSNDLHTNIESILNREKEKDDLRFSLGEPARTLRIVLQSVLDTNKVELKGIAV TIQDLTREVELNAAQNRFISNVSHELRTPLFNIKSYVETLHDLKDQLSDEEQIEFLGIANSETDRLTRLVNDVLDLSRLE SGKIVQLEQIDIKPAIEQTLRNYRLNATEKNVSLAHEIEETIPPILGNFDLLLQVFDNLLGNGLKFSPKNSSLIIRAYTW PDSCPAFPPNIKNNAAPQCELVSPLPKVRIEIADTGSGISQADQEKIFDRFYRVENSVHTEQGTGLGLSIVRGIIEKHGG EIRMASELGVGTTFWFDLSLAQSDKDELLTKALHNSDSFSGSEIKEII >Mature_688_residues MVDTNNQENRKYNITDNEVMDNNYWINGILAWWSGFSLRTKLLAIATLVVSLLMTGITFFALNSIQRDAGMNDTRYARDL GLLLSGNVTELVANNQKKEISNVAEKFWRSSRNLRYIFFTDAEDIVQLGIPISATPTSSDSQFQLTRRLKLPSELKKRPQ FPLVRQHATPQGQVTDVFVPMLWKGKYLGTLALGVTPNKKALASAALTREVTIAVFISIWVLVILGAVFNALTITRPVRE LVRGVREISRGNFKSRISLPMTGDLGELLNGFNRMATQLENYDEANIEELKAAQIKQQSLIATMADGAILLDSKGKIVLT NPTSKRLFRWEGRFLEGKYFLNEIPEILSNDLHTNIESILNREKEKDDLRFSLGEPARTLRIVLQSVLDTNKVELKGIAV TIQDLTREVELNAAQNRFISNVSHELRTPLFNIKSYVETLHDLKDQLSDEEQIEFLGIANSETDRLTRLVNDVLDLSRLE SGKIVQLEQIDIKPAIEQTLRNYRLNATEKNVSLAHEIEETIPPILGNFDLLLQVFDNLLGNGLKFSPKNSSLIIRAYTW PDSCPAFPPNIKNNAAPQCELVSPLPKVRIEIADTGSGISQADQEKIFDRFYRVENSVHTEQGTGLGLSIVRGIIEKHGG EIRMASELGVGTTFWFDLSLAQSDKDELLTKALHNSDSFSGSEIKEII
Specific function: Member Of The Two-Component Regulatory System Atos/Atoc; May Activate Atoc By Phosphorylation. [C]
COG id: COG0642
COG function: function code T; Signal transduction histidine kinase
Gene ontology:
Cell location: Cell membrane; Multi-pass membrane protein (Potential) [H]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 1 PAS (PER-ARNT-SIM) domain [H]
Homologues:
Organism=Escherichia coli, GI1788549, Length=411, Percent_Identity=25.7907542579075, Blast_Score=120, Evalue=3e-28, Organism=Escherichia coli, GI1788713, Length=252, Percent_Identity=28.5714285714286, Blast_Score=104, Evalue=2e-23, Organism=Escherichia coli, GI1789149, Length=268, Percent_Identity=28.7313432835821, Blast_Score=103, Evalue=3e-23, Organism=Escherichia coli, GI1788393, Length=285, Percent_Identity=28.4210526315789, Blast_Score=102, Evalue=1e-22, Organism=Escherichia coli, GI87082128, Length=313, Percent_Identity=25.8785942492013, Blast_Score=95, Evalue=1e-20, Organism=Escherichia coli, GI1786600, Length=263, Percent_Identity=25.8555133079848, Blast_Score=92, Evalue=1e-19, Organism=Escherichia coli, GI87081816, Length=251, Percent_Identity=28.2868525896414, Blast_Score=83, Evalue=6e-17, Organism=Escherichia coli, GI1786783, Length=272, Percent_Identity=23.5294117647059, Blast_Score=80, Evalue=3e-16, Organism=Escherichia coli, GI48994928, Length=248, Percent_Identity=29.0322580645161, Blast_Score=80, Evalue=5e-16, Organism=Escherichia coli, GI1790346, Length=231, Percent_Identity=26.8398268398268, Blast_Score=80, Evalue=6e-16, Organism=Escherichia coli, GI1788279, Length=226, Percent_Identity=26.5486725663717, Blast_Score=69, Evalue=8e-13, Organism=Escherichia coli, GI1786912, Length=261, Percent_Identity=26.0536398467433, Blast_Score=64, Evalue=3e-11,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR003594 - InterPro: IPR003660 - InterPro: IPR000014 - InterPro: IPR013767 - InterPro: IPR004358 - InterPro: IPR003661 - InterPro: IPR005467 - InterPro: IPR009082 [H]
Pfam domain/function: PF00672 HAMP; PF02518 HATPase_c; PF00512 HisKA; PF00989 PAS [H]
EC number: =2.7.13.3 [H]
Molecular weight: Translated: 77282; Mature: 77282
Theoretical pI: Translated: 5.82; Mature: 5.82
Prosite motif: PS50885 HAMP ; PS50109 HIS_KIN
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.3 %Cys (Translated Protein) 1.3 %Met (Translated Protein) 1.6 %Cys+Met (Translated Protein) 0.3 %Cys (Mature Protein) 1.3 %Met (Mature Protein) 1.6 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MVDTNNQENRKYNITDNEVMDNNYWINGILAWWSGFSLRTKLLAIATLVVSLLMTGITFF CCCCCCCCCCEECCCCCEEECCCCEEHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHH ALNSIQRDAGMNDTRYARDLGLLLSGNVTELVANNQKKEISNVAEKFWRSSRNLRYIFFT HHHHHHHHCCCCCHHHHHHHHHHCCCCHHHHHHCCCHHHHHHHHHHHHHCCCCEEEEEEE DAEDIVQLGIPISATPTSSDSQFQLTRRLKLPSELKKRPQFPLVRQHATPQGQVTDVFVP CHHHHHHHCCCCCCCCCCCCCHHHHHHHHCCCHHHHHCCCCCCHHCCCCCCCCCHHHHHH MLWKGKYLGTLALGVTPNKKALASAALTREVTIAVFISIWVLVILGAVFNALTITRPVRE HHHCCCEEEEEEEECCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH LVRGVREISRGNFKSRISLPMTGDLGELLNGFNRMATQLENYDEANIEELKAAQIKQQSL HHHHHHHHHCCCCCCEEECCCCCCHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHH IATMADGAILLDSKGKIVLTNPTSKRLFRWEGRFLEGKYFLNEIPEILSNDLHTNIESIL HHHHCCCEEEEECCCCEEEECCCCCCCEEECCCEECCHHHHHHHHHHHHHHHHHHHHHHH NREKEKDDLRFSLGEPARTLRIVLQSVLDTNKVELKGIAVTIQDLTREVELNAAQNRFIS CCCCCCCCCEEECCCHHHHHHHHHHHHHCCCCEEEEEEEEEHHHHHHHHHCCHHHHHHHH NVSHELRTPLFNIKSYVETLHDLKDQLSDEEQIEFLGIANSETDRLTRLVNDVLDLSRLE HHHHHHHCHHHHHHHHHHHHHHHHHHCCCCCCEEEEEECCCCHHHHHHHHHHHHHHHHCC SGKIVQLEQIDIKPAIEQTLRNYRLNATEKNVSLAHEIEETIPPILGNFDLLLQVFDNLL CCCEEEEEECCCCHHHHHHHHHCCCCCCCCCHHHHHHHHHHCCHHHCCHHHHHHHHHHHH GNGLKFSPKNSSLIIRAYTWPDSCPAFPPNIKNNAAPQCELVSPLPKVRIEIADTGSGIS CCCCEECCCCCEEEEEEEECCCCCCCCCCCCCCCCCCCCEECCCCCCEEEEEECCCCCCC QADQEKIFDRFYRVENSVHTEQGTGLGLSIVRGIIEKHGGEIRMASELGVGTTFWFDLSL HHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHCCCCEEEEHHCCCCEEEEEEEEC AQSDKDELLTKALHNSDSFSGSEIKEII CCCCHHHHHHHHHHCCCCCCCHHHHHCC >Mature Secondary Structure MVDTNNQENRKYNITDNEVMDNNYWINGILAWWSGFSLRTKLLAIATLVVSLLMTGITFF CCCCCCCCCCEECCCCCEEECCCCEEHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHH ALNSIQRDAGMNDTRYARDLGLLLSGNVTELVANNQKKEISNVAEKFWRSSRNLRYIFFT HHHHHHHHCCCCCHHHHHHHHHHCCCCHHHHHHCCCHHHHHHHHHHHHHCCCCEEEEEEE DAEDIVQLGIPISATPTSSDSQFQLTRRLKLPSELKKRPQFPLVRQHATPQGQVTDVFVP CHHHHHHHCCCCCCCCCCCCCHHHHHHHHCCCHHHHHCCCCCCHHCCCCCCCCCHHHHHH MLWKGKYLGTLALGVTPNKKALASAALTREVTIAVFISIWVLVILGAVFNALTITRPVRE HHHCCCEEEEEEEECCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH LVRGVREISRGNFKSRISLPMTGDLGELLNGFNRMATQLENYDEANIEELKAAQIKQQSL HHHHHHHHHCCCCCCEEECCCCCCHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHH IATMADGAILLDSKGKIVLTNPTSKRLFRWEGRFLEGKYFLNEIPEILSNDLHTNIESIL HHHHCCCEEEEECCCCEEEECCCCCCCEEECCCEECCHHHHHHHHHHHHHHHHHHHHHHH NREKEKDDLRFSLGEPARTLRIVLQSVLDTNKVELKGIAVTIQDLTREVELNAAQNRFIS CCCCCCCCCEEECCCHHHHHHHHHHHHHCCCCEEEEEEEEEHHHHHHHHHCCHHHHHHHH NVSHELRTPLFNIKSYVETLHDLKDQLSDEEQIEFLGIANSETDRLTRLVNDVLDLSRLE HHHHHHHCHHHHHHHHHHHHHHHHHHCCCCCCEEEEEECCCCHHHHHHHHHHHHHHHHCC SGKIVQLEQIDIKPAIEQTLRNYRLNATEKNVSLAHEIEETIPPILGNFDLLLQVFDNLL CCCEEEEEECCCCHHHHHHHHHCCCCCCCCCHHHHHHHHHHCCHHHCCHHHHHHHHHHHH GNGLKFSPKNSSLIIRAYTWPDSCPAFPPNIKNNAAPQCELVSPLPKVRIEIADTGSGIS CCCCEECCCCCEEEEEEEECCCCCCCCCCCCCCCCCCCCEECCCCCCEEEEEECCCCCCC QADQEKIFDRFYRVENSVHTEQGTGLGLSIVRGIIEKHGGEIRMASELGVGTTFWFDLSL HHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHCCCCEEEEHHCCCCEEEEEEEEC AQSDKDELLTKALHNSDSFSGSEIKEII CCCCHHHHHHHHHHCCCCCCCHHHHHCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 6.0
TargetDB status: NA
Availability: NA
References: 8535519; 8905231; 3141423 [H]