| Definition | Prochlorococcus marinus str. MIT 9303, complete genome. |
|---|---|
| Accession | NC_008820 |
| Length | 2,682,675 |
Click here to switch to the map view.
The map label for this gene is nblS [H]
Identifier: 124022255
GI number: 124022255
Start: 526341
End: 528398
Strand: Reverse
Name: nblS [H]
Synonym: P9303_05451
Alternate gene names: 124022255
Gene position: 528398-526341 (Counterclockwise)
Preceding gene: 124022256
Following gene: 124022252
Centisome position: 19.7
GC content: 52.67
Gene sequence:
>2058_bases ATGGCCAGCAGTACTTCGCAAGCCATCGCAGAGTGGGCTCCCCCAGGAGATGGCCAACCCCCACCAGAGCCACCCGGCTG GGGGGAACGCATCTATCTCTGGTGGGCAGAATTCAGCCTGCAAACCAAGTTGTTGGCAATCGCCACACTGGTGGTGAGCC TGCTGATGACAGGCATCACCTTCTTCGTCCTCAACGGCATCCAAAGGGATGCAGGGATGAATGACACGCGTTACGCCAGG GATCTAGGACTCCTCCTTTCCGGAAACGTCACTGAACTTGTCGCCCAAGGACGTGACAGGGAGCTGGCAACTGTTGCCGA ACAATTCTGGCGCTCGCGCAGCCTTCGTTACATCTTCTTCGCCGACCCAGATGGCTTGATCTATCTAGGAATCCCCATTA GCGCTTCCCCTGTCAGCGGTGATAACGACCTGCAGCTCAACCATCGCTTGGAACTGCCAGCAGAGCTGCCATCACGACCA GAAAACGCACTGATTCGCCAGCACCTCACCCCTCAAGGTCAACTCACCGATGTCTTCGTTCCACTGGTGTGGAAAGGCGA TTATCTGGGGACCCTGGCTCTGGGGGTCAACCCCAACGACACAGCTCTTGCCAGCGCGGCTCTCACGCGACAGGTGACGA TTGCCGTCTTCATCTCCATCTGGGTGCTTGTGATTCTTGGCGCCGTCTTCAATGCTCTAACGATCACGCAGCCTGTAAAG GAGCTTCTGCGCGGTGTAAGGGCCATTGCTTCCGGCAATTTCGAAGCTCGAATCGCTCTACCGATGGGAGGAGAACTGGG AGAACTCCTGAATGGCTTCAACGCCATGGCCTCCCAACTTGAGGCCTATGACGCCGCCAATATTGAAGAGCTCACTGCCG CCCAAGTAAAGCAGCAATCGCTGATTGCCACGATGGCCGATGGCGCTTTACTGCTCGATGAAGTTGGACAAATCGTGCTG GCCAATCCAACAGCACGGCGGCTATTTCGCTGGGAAGGTCGCAATCTTGAGGGTCAGGAACTGCTCAATGAGTTGCCGGA GATCATCGCAAACGAACTGCATGATCCCCTTCAATCTCTGCTGCGCAATATCGGTGAAAGCAACGATCTGCGTTGCAGTC TTGAAGAACCAACACGCACACTTCGCATCGTGTTGCAGTCAGTGCGCGATCAAAGCGGTGAAACCCTTAAAGGCATCGCA ATCACAGTGCAGGACCTCACCAGAGAAGTGGAGCTCAATGCAGCCCAAAGCCGCTTCATCAGCAACGTTTCACATGAACT TAGAACACCACTGTTCAACATCAAAAGCTATGTAGAAACACTGCATGATCTCGGTGATCAACTCAGCGAAGAGGAAAAGA AAGAATTTTTAGGTGTTGCTAATTCCGAAACCGATAGGCTGGCTCGACTCGTTAATGATGTGCTCGACCTTTCGCGCTTG GAATCCGGACGGACCGTGCAGTTCGAGCCCATGGATCTTCGCCCTGCCATCGAGCAAACCCTACGCAACTATCGACTTAA TGCAGATGACAAGCAGATTCATATTGAGCTCAATACGGATGATGAGCTACCAACAATCCTTGGAAATTGGGATCTACTAC TCCAAGTGCTTGACAATTTAGTTGGCAATGGGCTCAAGTTTAGTCGTGCTGGTGGAAGCCTGATGGTGCGAGCCTACACA TGGCCTGATAGCTGCAAAATGTCTCCAATCGAGAGCAGCAAATCAGCACCACATTGCGAATTTTTCTCACCACTCCCCAA GCTCCGCGTAGAAGTTGCGGACACCGGCCATGGCATCAATCAGGATGACCAACAGCATATTTTTGACCGCTTCTATCGTG TGGAAAATGCCGTGCATACAGAAGCTGGCACCGGTCTTGGGCTATCAATCGTGCGCGGCATCATCGAAAAGCATGGCGGC CAAATACGAATGGCCAGTGAGGTTGACCTGGGCACAACCTTTTGGTTTGATCTACCTCTTGAGCAAACAGATGCAGATGA GCTTATCGTTCAATCAGTACGAACAACTCGGCAACAAGAACAAGGTTTAGAACTCTAA
Upstream 100 bases:
>100_bases CCAAGGTCTTGATCAGGTGTATTTCGAAGGGATCACTTACCGTCGGGACATCGGTCACCAAGTGCGCCAGTCCTAGGGTG AAGAGACGCTGAATGGGTTG
Downstream 100 bases:
>100_bases TTCAGCCAATAACCTGAATCAGCTAGCATTTTAAAGGCCCTTGGCATCGAAGCAACATTAAGAGCGTTCGTCGTCAGCAA TACGATGAGGAGCACCACTG
Product: two-component sensor histidine kinase
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 685; Mature: 684
Protein sequence:
>685_residues MASSTSQAIAEWAPPGDGQPPPEPPGWGERIYLWWAEFSLQTKLLAIATLVVSLLMTGITFFVLNGIQRDAGMNDTRYAR DLGLLLSGNVTELVAQGRDRELATVAEQFWRSRSLRYIFFADPDGLIYLGIPISASPVSGDNDLQLNHRLELPAELPSRP ENALIRQHLTPQGQLTDVFVPLVWKGDYLGTLALGVNPNDTALASAALTRQVTIAVFISIWVLVILGAVFNALTITQPVK ELLRGVRAIASGNFEARIALPMGGELGELLNGFNAMASQLEAYDAANIEELTAAQVKQQSLIATMADGALLLDEVGQIVL ANPTARRLFRWEGRNLEGQELLNELPEIIANELHDPLQSLLRNIGESNDLRCSLEEPTRTLRIVLQSVRDQSGETLKGIA ITVQDLTREVELNAAQSRFISNVSHELRTPLFNIKSYVETLHDLGDQLSEEEKKEFLGVANSETDRLARLVNDVLDLSRL ESGRTVQFEPMDLRPAIEQTLRNYRLNADDKQIHIELNTDDELPTILGNWDLLLQVLDNLVGNGLKFSRAGGSLMVRAYT WPDSCKMSPIESSKSAPHCEFFSPLPKLRVEVADTGHGINQDDQQHIFDRFYRVENAVHTEAGTGLGLSIVRGIIEKHGG QIRMASEVDLGTTFWFDLPLEQTDADELIVQSVRTTRQQEQGLEL
Sequences:
>Translated_685_residues MASSTSQAIAEWAPPGDGQPPPEPPGWGERIYLWWAEFSLQTKLLAIATLVVSLLMTGITFFVLNGIQRDAGMNDTRYAR DLGLLLSGNVTELVAQGRDRELATVAEQFWRSRSLRYIFFADPDGLIYLGIPISASPVSGDNDLQLNHRLELPAELPSRP ENALIRQHLTPQGQLTDVFVPLVWKGDYLGTLALGVNPNDTALASAALTRQVTIAVFISIWVLVILGAVFNALTITQPVK ELLRGVRAIASGNFEARIALPMGGELGELLNGFNAMASQLEAYDAANIEELTAAQVKQQSLIATMADGALLLDEVGQIVL ANPTARRLFRWEGRNLEGQELLNELPEIIANELHDPLQSLLRNIGESNDLRCSLEEPTRTLRIVLQSVRDQSGETLKGIA ITVQDLTREVELNAAQSRFISNVSHELRTPLFNIKSYVETLHDLGDQLSEEEKKEFLGVANSETDRLARLVNDVLDLSRL ESGRTVQFEPMDLRPAIEQTLRNYRLNADDKQIHIELNTDDELPTILGNWDLLLQVLDNLVGNGLKFSRAGGSLMVRAYT WPDSCKMSPIESSKSAPHCEFFSPLPKLRVEVADTGHGINQDDQQHIFDRFYRVENAVHTEAGTGLGLSIVRGIIEKHGG QIRMASEVDLGTTFWFDLPLEQTDADELIVQSVRTTRQQEQGLEL >Mature_684_residues ASSTSQAIAEWAPPGDGQPPPEPPGWGERIYLWWAEFSLQTKLLAIATLVVSLLMTGITFFVLNGIQRDAGMNDTRYARD LGLLLSGNVTELVAQGRDRELATVAEQFWRSRSLRYIFFADPDGLIYLGIPISASPVSGDNDLQLNHRLELPAELPSRPE NALIRQHLTPQGQLTDVFVPLVWKGDYLGTLALGVNPNDTALASAALTRQVTIAVFISIWVLVILGAVFNALTITQPVKE LLRGVRAIASGNFEARIALPMGGELGELLNGFNAMASQLEAYDAANIEELTAAQVKQQSLIATMADGALLLDEVGQIVLA NPTARRLFRWEGRNLEGQELLNELPEIIANELHDPLQSLLRNIGESNDLRCSLEEPTRTLRIVLQSVRDQSGETLKGIAI TVQDLTREVELNAAQSRFISNVSHELRTPLFNIKSYVETLHDLGDQLSEEEKKEFLGVANSETDRLARLVNDVLDLSRLE SGRTVQFEPMDLRPAIEQTLRNYRLNADDKQIHIELNTDDELPTILGNWDLLLQVLDNLVGNGLKFSRAGGSLMVRAYTW PDSCKMSPIESSKSAPHCEFFSPLPKLRVEVADTGHGINQDDQQHIFDRFYRVENAVHTEAGTGLGLSIVRGIIEKHGGQ IRMASEVDLGTTFWFDLPLEQTDADELIVQSVRTTRQQEQGLEL
Specific function: Member Of The Two-Component Regulatory System Atos/Atoc; May Activate Atoc By Phosphorylation. [C]
COG id: COG0642
COG function: function code T; Signal transduction histidine kinase
Gene ontology:
Cell location: Cell membrane; Multi-pass membrane protein (Potential) [H]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 1 PAS (PER-ARNT-SIM) domain [H]
Homologues:
Organism=Escherichia coli, GI1788549, Length=408, Percent_Identity=26.2254901960784, Blast_Score=114, Evalue=2e-26, Organism=Escherichia coli, GI1789149, Length=298, Percent_Identity=27.8523489932886, Blast_Score=112, Evalue=9e-26, Organism=Escherichia coli, GI1788393, Length=274, Percent_Identity=28.8321167883212, Blast_Score=104, Evalue=2e-23, Organism=Escherichia coli, GI1788713, Length=257, Percent_Identity=27.2373540856031, Blast_Score=100, Evalue=2e-22, Organism=Escherichia coli, GI1786600, Length=409, Percent_Identity=27.1393643031785, Blast_Score=99, Evalue=7e-22, Organism=Escherichia coli, GI1790436, Length=264, Percent_Identity=28.4090909090909, Blast_Score=96, Evalue=8e-21, Organism=Escherichia coli, GI87082128, Length=249, Percent_Identity=26.5060240963855, Blast_Score=92, Evalue=8e-20, Organism=Escherichia coli, GI87081816, Length=250, Percent_Identity=28.4, Blast_Score=91, Evalue=3e-19, Organism=Escherichia coli, GI145693157, Length=268, Percent_Identity=29.8507462686567, Blast_Score=88, Evalue=2e-18, Organism=Escherichia coli, GI48994928, Length=244, Percent_Identity=29.5081967213115, Blast_Score=85, Evalue=2e-17, Organism=Escherichia coli, GI1786783, Length=311, Percent_Identity=24.4372990353698, Blast_Score=82, Evalue=1e-16, Organism=Escherichia coli, GI1788279, Length=226, Percent_Identity=26.5486725663717, Blast_Score=69, Evalue=1e-12, Organism=Escherichia coli, GI1786912, Length=252, Percent_Identity=27.3809523809524, Blast_Score=68, Evalue=2e-12,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR003594 - InterPro: IPR003660 - InterPro: IPR000014 - InterPro: IPR013767 - InterPro: IPR004358 - InterPro: IPR003661 - InterPro: IPR005467 - InterPro: IPR009082 [H]
Pfam domain/function: PF00672 HAMP; PF02518 HATPase_c; PF00512 HisKA; PF00989 PAS [H]
EC number: =2.7.13.3 [H]
Molecular weight: Translated: 75884; Mature: 75753
Theoretical pI: Translated: 4.48; Mature: 4.48
Prosite motif: PS50885 HAMP ; PS50112 PAS ; PS50109 HIS_KIN
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.4 %Cys (Translated Protein) 1.5 %Met (Translated Protein) 1.9 %Cys+Met (Translated Protein) 0.4 %Cys (Mature Protein) 1.3 %Met (Mature Protein) 1.8 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MASSTSQAIAEWAPPGDGQPPPEPPGWGERIYLWWAEFSLQTKLLAIATLVVSLLMTGIT CCCCHHHHHHHCCCCCCCCCCCCCCCCCCEEEEEEECHHHHHHHHHHHHHHHHHHHHHHH FFVLNGIQRDAGMNDTRYARDLGLLLSGNVTELVAQGRDRELATVAEQFWRSRSLRYIFF HHHHHHHHHCCCCCCHHHHHHHHHHCCCCHHHHHHCCCCCHHHHHHHHHHHCCCCEEEEE ADPDGLIYLGIPISASPVSGDNDLQLNHRLELPAELPSRPENALIRQHLTPQGQLTDVFV ECCCCEEEEEECCCCCCCCCCCCEEECEEECCCCCCCCCCHHHHHHHHCCCCCCEEEEEE PLVWKGDYLGTLALGVNPNDTALASAALTRQVTIAVFISIWVLVILGAVFNALTITQPVK EEEECCCCEEEEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH ELLRGVRAIASGNFEARIALPMGGELGELLNGFNAMASQLEAYDAANIEELTAAQVKQQS HHHHHHHHHHCCCCEEEEEECCCCHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHH LIATMADGALLLDEVGQIVLANPTARRLFRWEGRNLEGQELLNELPEIIANELHDPLQSL HHHHHCCCHHHHHHCCCEEEECHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHHHH LRNIGESNDLRCSLEEPTRTLRIVLQSVRDQSGETLKGIAITVQDLTREVELNAAQSRFI HHHCCCCCCEEEECCHHHHHHHHHHHHHHCCCCCEEEHHEEEHHHHHHHHHHHHHHHHHH SNVSHELRTPLFNIKSYVETLHDLGDQLSEEEKKEFLGVANSETDRLARLVNDVLDLSRL HHHHHHHHCHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHC ESGRTVQFEPMDLRPAIEQTLRNYRLNADDKQIHIELNTDDELPTILGNWDLLLQVLDNL CCCCEEEECCCCCCHHHHHHHHHCCCCCCCCEEEEEECCCCCCCHHHCCHHHHHHHHHHH VGNGLKFSRAGGSLMVRAYTWPDSCKMSPIESSKSAPHCEFFSPLPKLRVEVADTGHGIN HCCCEEEECCCCEEEEEEEECCCCCCCCCCCCCCCCCCCHHHCCCCHHEEEEECCCCCCC QDDQQHIFDRFYRVENAVHTEAGTGLGLSIVRGIIEKHGGQIRMASEVDLGTTFWFDLPL CCHHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHCCCCEEEECCCCCCEEEEEECCC EQTDADELIVQSVRTTRQQEQGLEL CCCCHHHHHHHHHHHHHHHHCCCCC >Mature Secondary Structure ASSTSQAIAEWAPPGDGQPPPEPPGWGERIYLWWAEFSLQTKLLAIATLVVSLLMTGIT CCCHHHHHHHCCCCCCCCCCCCCCCCCCEEEEEEECHHHHHHHHHHHHHHHHHHHHHHH FFVLNGIQRDAGMNDTRYARDLGLLLSGNVTELVAQGRDRELATVAEQFWRSRSLRYIFF HHHHHHHHHCCCCCCHHHHHHHHHHCCCCHHHHHHCCCCCHHHHHHHHHHHCCCCEEEEE ADPDGLIYLGIPISASPVSGDNDLQLNHRLELPAELPSRPENALIRQHLTPQGQLTDVFV ECCCCEEEEEECCCCCCCCCCCCEEECEEECCCCCCCCCCHHHHHHHHCCCCCCEEEEEE PLVWKGDYLGTLALGVNPNDTALASAALTRQVTIAVFISIWVLVILGAVFNALTITQPVK EEEECCCCEEEEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH ELLRGVRAIASGNFEARIALPMGGELGELLNGFNAMASQLEAYDAANIEELTAAQVKQQS HHHHHHHHHHCCCCEEEEEECCCCHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHH LIATMADGALLLDEVGQIVLANPTARRLFRWEGRNLEGQELLNELPEIIANELHDPLQSL HHHHHCCCHHHHHHCCCEEEECHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHHHH LRNIGESNDLRCSLEEPTRTLRIVLQSVRDQSGETLKGIAITVQDLTREVELNAAQSRFI HHHCCCCCCEEEECCHHHHHHHHHHHHHHCCCCCEEEHHEEEHHHHHHHHHHHHHHHHHH SNVSHELRTPLFNIKSYVETLHDLGDQLSEEEKKEFLGVANSETDRLARLVNDVLDLSRL HHHHHHHHCHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHC ESGRTVQFEPMDLRPAIEQTLRNYRLNADDKQIHIELNTDDELPTILGNWDLLLQVLDNL CCCCEEEECCCCCCHHHHHHHHHCCCCCCCCEEEEEECCCCCCCHHHCCHHHHHHHHHHH VGNGLKFSRAGGSLMVRAYTWPDSCKMSPIESSKSAPHCEFFSPLPKLRVEVADTGHGIN HCCCEEEECCCCEEEEEEEECCCCCCCCCCCCCCCCCCCHHHCCCCHHEEEEECCCCCCC QDDQQHIFDRFYRVENAVHTEAGTGLGLSIVRGIIEKHGGQIRMASEVDLGTTFWFDLPL CCHHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHCCCCEEEECCCCCCEEEEEECCC EQTDADELIVQSVRTTRQQEQGLEL CCCCHHHHHHHHHHHHHHHHCCCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 6.0
TargetDB status: NA
Availability: NA
References: 8535519; 8905231; 3141423 [H]