| Definition | Nostoc sp. PCC 7120, complete genome. |
|---|---|
| Accession | NC_003272 |
| Length | 6,413,771 |
Click here to switch to the map view.
The map label for this gene is sasA [H]
Identifier: 17231055
GI number: 17231055
Start: 4302339
End: 4304216
Strand: Reverse
Name: sasA [H]
Synonym: all3563
Alternate gene names: 17231055
Gene position: 4304216-4302339 (Counterclockwise)
Preceding gene: 17231056
Following gene: 17231052
Centisome position: 67.11
GC content: 43.24
Gene sequence:
>1878_bases ATGACTACCTTTTTGATCAAATTGCAGAGGTTGTGGAGAAAGACTCTGTCTGCACTCACGTTAGATGAAATCACCACTGT TTACCAAAATCGCTCTCAACAACAGGAATGGCTGGTAAATAGACAACGTTTTTTATGGCAGAGGCTACATCTGTGGTTAT GGCTAGTACTAGGTTGTCTATTGACATTTACCCTCAGAAATGTGTACGACCTATTTTTTCCCCTCCGGGAGTTGAAGGCA CTACCCCAGGTTTTGAGAACTCAAGGGCTAATGATCAATGCAGCTATGTTATTGAGCCTGCTGGTTTGTTTTACCCTGCA TAAAACACGGTTTGGTCATCGCCATCCAGGTATTCTATTTTTAGGCTCATCTTGGTCGTTGAGTTTAGCATCACAGTTAT TTGCCACCCTTAAAGGTTTTGCCTTACCCGATACCCTTGGCTGGTCATTACTATTTTTAAGTCAAGCTACACTTATGCCT GTGCGCTGGACTCTGCATTTAGTTTGTCAGCTAGGGATTTTAGTTTACTACTTTGGTGTGAACACAGCTTTGAGGCTCAG TACACCTGCACCGAACCATCCAGAAATATATAATGTTACGTTTATTCTCTACATCTTTTGGTTTTGTATTATATGTGATT TAGGGGTTTACTTATACGATCGCCTGCAACGCTCTGAATTTTACGCCCGCAAAGAACTAGAGTCAGCCAACAATAAATTA CGGCTAGCAGAAGCGAAATATCGCAGCATCTTTGAAAATGCCATTGAAGGTATTTTTCAAAGTAGCCCTGATGGACGTTA CATTACAGCAAATCCTGCTTTAGCACGTATTTATGGTTACACTTCTCCCGAAGAAGTAACAGAAAATTTTACGGATATTG AGCATCAATTATACGTTGACCCTAAACGCCGAGCCGAATTTGTCCGGTTGATGGAAGAATCTGGATTAGCTCCAGAATTT GAGTCACAGATTTATCGTCAAGATGGCAGCGTTGTCTGGATTTCCGAAAAAGCCTACGCCGTTCGTGACGAACAAGGAAA TCTCCTTTACTACGAAGGGTTGGTTGAAGATATTACCCAACGCAAACAAGCCCAAGAAGCACTGAGGGTCTTTTTCCATG CGGTGTCCCATGACTTACGTAACCCAGTTTTAGGGACTTTGATGGTGTTGAGGAATTTACTTAATGACGAGGCAGGGGAA GCAGGGAAAGCAGAGGAGGCAGGGGGAGAACTGACTGCAAGATTTTCGCCCAGTCCCCAGTCCCCAATCCCCAGTCCCCA ATCCCCAATCCCTGTCCCTCGCTCAATTTTAAAGCGGATGGTGCAAAGTAGCGATCGCCAACTCAATCTGATTAACTCTT TATTAGAAGCCCATATTGGTGAGGTGCAGGGTTTGAGCTTGCAATGTCAGCCTGTACAATTACAGATGGTGGTAGAAGCG GCGATCGCAGATTTAGAACCCATGTTGGTAGATAATCAAGCCACTTTGATAAATTTAGTCACCGCAGATTTACCATTAGT AAATGCCGATCCTACGCAAGTATGGCGAGTGTTTTCTAACTTCATCGTCAATGCCATCAAGCATAATCCCCCTGGATTAC ACCTAACAATCAATGCTATTCCCCAAGATGACGAAATTTACTGCACTGTCAATGATAACGGTGTAGGCATCAGTCAACAA CAGAGCGATCGGTTATTTGACCTTTATTTTCGGGGTGGTAGTATTCGTAATTCCTTGGGTTTAGGCTTGGGTTTATACCT ATGTAAGCAAATCATCACTGCTCACGGCGGTGAAATTGGGGTAAAAAGTGGTTTAGAGAAAGGGGCTACATTCTGGTTTA CGTTGCCCATGACATCAAATCAGGTTAACCAATTATAG
Upstream 100 bases:
>100_bases CCTCACGATGAATTGTTCAACGTAAAAGCAGAATTGGTATTATGAAAGTCTGCAAATAGGAAACACCTACAATCGTATAG GTGAAGTTGGTAAGGCTCTC
Downstream 100 bases:
>100_bases TTTCTGCCCAGCATAGATTGATCGCACTTCACCATTACGCCGAACTATAGCTTCACCATTATTGACATCAACTAAAGTCC AACCGCTAGCACCAATAGTT
Product: two-component sensor histidine kinase
Products: NA
Alternate protein names: Synechococcus adaptive sensor protein A [H]
Number of amino acids: Translated: 625; Mature: 624
Protein sequence:
>625_residues MTTFLIKLQRLWRKTLSALTLDEITTVYQNRSQQQEWLVNRQRFLWQRLHLWLWLVLGCLLTFTLRNVYDLFFPLRELKA LPQVLRTQGLMINAAMLLSLLVCFTLHKTRFGHRHPGILFLGSSWSLSLASQLFATLKGFALPDTLGWSLLFLSQATLMP VRWTLHLVCQLGILVYYFGVNTALRLSTPAPNHPEIYNVTFILYIFWFCIICDLGVYLYDRLQRSEFYARKELESANNKL RLAEAKYRSIFENAIEGIFQSSPDGRYITANPALARIYGYTSPEEVTENFTDIEHQLYVDPKRRAEFVRLMEESGLAPEF ESQIYRQDGSVVWISEKAYAVRDEQGNLLYYEGLVEDITQRKQAQEALRVFFHAVSHDLRNPVLGTLMVLRNLLNDEAGE AGKAEEAGGELTARFSPSPQSPIPSPQSPIPVPRSILKRMVQSSDRQLNLINSLLEAHIGEVQGLSLQCQPVQLQMVVEA AIADLEPMLVDNQATLINLVTADLPLVNADPTQVWRVFSNFIVNAIKHNPPGLHLTINAIPQDDEIYCTVNDNGVGISQQ QSDRLFDLYFRGGSIRNSLGLGLGLYLCKQIITAHGGEIGVKSGLEKGATFWFTLPMTSNQVNQL
Sequences:
>Translated_625_residues MTTFLIKLQRLWRKTLSALTLDEITTVYQNRSQQQEWLVNRQRFLWQRLHLWLWLVLGCLLTFTLRNVYDLFFPLRELKA LPQVLRTQGLMINAAMLLSLLVCFTLHKTRFGHRHPGILFLGSSWSLSLASQLFATLKGFALPDTLGWSLLFLSQATLMP VRWTLHLVCQLGILVYYFGVNTALRLSTPAPNHPEIYNVTFILYIFWFCIICDLGVYLYDRLQRSEFYARKELESANNKL RLAEAKYRSIFENAIEGIFQSSPDGRYITANPALARIYGYTSPEEVTENFTDIEHQLYVDPKRRAEFVRLMEESGLAPEF ESQIYRQDGSVVWISEKAYAVRDEQGNLLYYEGLVEDITQRKQAQEALRVFFHAVSHDLRNPVLGTLMVLRNLLNDEAGE AGKAEEAGGELTARFSPSPQSPIPSPQSPIPVPRSILKRMVQSSDRQLNLINSLLEAHIGEVQGLSLQCQPVQLQMVVEA AIADLEPMLVDNQATLINLVTADLPLVNADPTQVWRVFSNFIVNAIKHNPPGLHLTINAIPQDDEIYCTVNDNGVGISQQ QSDRLFDLYFRGGSIRNSLGLGLGLYLCKQIITAHGGEIGVKSGLEKGATFWFTLPMTSNQVNQL >Mature_624_residues TTFLIKLQRLWRKTLSALTLDEITTVYQNRSQQQEWLVNRQRFLWQRLHLWLWLVLGCLLTFTLRNVYDLFFPLRELKAL PQVLRTQGLMINAAMLLSLLVCFTLHKTRFGHRHPGILFLGSSWSLSLASQLFATLKGFALPDTLGWSLLFLSQATLMPV RWTLHLVCQLGILVYYFGVNTALRLSTPAPNHPEIYNVTFILYIFWFCIICDLGVYLYDRLQRSEFYARKELESANNKLR LAEAKYRSIFENAIEGIFQSSPDGRYITANPALARIYGYTSPEEVTENFTDIEHQLYVDPKRRAEFVRLMEESGLAPEFE SQIYRQDGSVVWISEKAYAVRDEQGNLLYYEGLVEDITQRKQAQEALRVFFHAVSHDLRNPVLGTLMVLRNLLNDEAGEA GKAEEAGGELTARFSPSPQSPIPSPQSPIPVPRSILKRMVQSSDRQLNLINSLLEAHIGEVQGLSLQCQPVQLQMVVEAA IADLEPMLVDNQATLINLVTADLPLVNADPTQVWRVFSNFIVNAIKHNPPGLHLTINAIPQDDEIYCTVNDNGVGISQQQ SDRLFDLYFRGGSIRNSLGLGLGLYLCKQIITAHGGEIGVKSGLEKGATFWFTLPMTSNQVNQL
Specific function: May be involved in signal transduction. Participates in the kaiABC clock protein complex, which constitutes the main circadian regulator in cyanobacteria, via its interaction with kaiC. Required for robustness of the circadian rhythm of gene expression an
COG id: NA
COG function: NA
Gene ontology:
Cell location: Integral Membrane Protein. Inner Membrane [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 1 histidine kinase domain [H]
Homologues:
Organism=Escherichia coli, GI145693157, Length=276, Percent_Identity=27.8985507246377, Blast_Score=91, Evalue=3e-19, Organism=Escherichia coli, GI1786912, Length=259, Percent_Identity=30.5019305019305, Blast_Score=85, Evalue=1e-17, Organism=Escherichia coli, GI48994928, Length=415, Percent_Identity=24.3373493975904, Blast_Score=82, Evalue=9e-17, Organism=Escherichia coli, GI1786600, Length=267, Percent_Identity=25.0936329588015, Blast_Score=82, Evalue=1e-16, Organism=Escherichia coli, GI1788549, Length=369, Percent_Identity=25.2032520325203, Blast_Score=77, Evalue=5e-15, Organism=Escherichia coli, GI1789149, Length=270, Percent_Identity=26.6666666666667, Blast_Score=74, Evalue=2e-14, Organism=Escherichia coli, GI1790436, Length=264, Percent_Identity=25.3787878787879, Blast_Score=73, Evalue=6e-14, Organism=Escherichia coli, GI1788713, Length=120, Percent_Identity=34.1666666666667, Blast_Score=68, Evalue=2e-12, Organism=Escherichia coli, GI1788393, Length=261, Percent_Identity=24.5210727969349, Blast_Score=67, Evalue=2e-12,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR003594 - InterPro: IPR011649 - InterPro: IPR004358 - InterPro: IPR003661 - InterPro: IPR005467 - InterPro: IPR009082 - InterPro: IPR012336 - InterPro: IPR012335 [H]
Pfam domain/function: PF02518 HATPase_c; PF00512 HisKA; PF07689 KaiB [H]
EC number: 2.7.3.- [C]
Molecular weight: Translated: 70925; Mature: 70794
Theoretical pI: Translated: 6.70; Mature: 6.70
Prosite motif: PS50112 PAS ; PS50113 PAC ; PS50109 HIS_KIN
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.3 %Cys (Translated Protein) 1.6 %Met (Translated Protein) 2.9 %Cys+Met (Translated Protein) 1.3 %Cys (Mature Protein) 1.4 %Met (Mature Protein) 2.7 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MTTFLIKLQRLWRKTLSALTLDEITTVYQNRSQQQEWLVNRQRFLWQRLHLWLWLVLGCL CCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHH LTFTLRNVYDLFFPLRELKALPQVLRTQGLMINAAMLLSLLVCFTLHKTRFGHRHPGILF HHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCEEE LGSSWSLSLASQLFATLKGFALPDTLGWSLLFLSQATLMPVRWTLHLVCQLGILVYYFGV ECCCCCHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCC NTALRLSTPAPNHPEIYNVTFILYIFWFCIICDLGVYLYDRLQRSEFYARKELESANNKL CCEEEECCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCE RLAEAKYRSIFENAIEGIFQSSPDGRYITANPALARIYGYTSPEEVTENFTDIEHQLYVD EEHHHHHHHHHHHHHHHHHCCCCCCCEEECCCHHHHHCCCCCHHHHHHHHHCCCCEEEEC PKRRAEFVRLMEESGLAPEFESQIYRQDGSVVWISEKAYAVRDEQGNLLYYEGLVEDITQ HHHHHHHHHHHHHCCCCCHHHHHHHHCCCCEEEEECCEEEEECCCCCEEEEHHHHHHHHH RKQAQEALRVFFHAVSHDLRNPVLGTLMVLRNLLNDEAGEAGKAEEAGGELTARFSPSPQ HHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHCCCCCCCCCCHHCCCCEEEEECCCCC SPIPSPQSPIPVPRSILKRMVQSSDRQLNLINSLLEAHIGEVQGLSLQCQPVQLQMVVEA CCCCCCCCCCCCCHHHHHHHHHCCCCHHHHHHHHHHHHHCCCCCCCEEECCHHHHHHHHH AIADLEPMLVDNQATLINLVTADLPLVNADPTQVWRVFSNFIVNAIKHNPPGLHLTINAI HHHCCCCEEECCCHHEEEEEECCCCCCCCCHHHHHHHHHHHHHHHHHCCCCCEEEEEEEC PQDDEIYCTVNDNGVGISQQQSDRLFDLYFRGGSIRNSLGLGLGLYLCKQIITAHGGEIG CCCCCEEEEECCCCCCCCCCCCCCEEEEEECCCCCHHHHHHHHHHHHHHHHHHHCCCCCC VKSGLEKGATFWFTLPMTSNQVNQL HHHCCCCCCEEEEEECCCCCHHCCC >Mature Secondary Structure TTFLIKLQRLWRKTLSALTLDEITTVYQNRSQQQEWLVNRQRFLWQRLHLWLWLVLGCL CHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHH LTFTLRNVYDLFFPLRELKALPQVLRTQGLMINAAMLLSLLVCFTLHKTRFGHRHPGILF HHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCEEE LGSSWSLSLASQLFATLKGFALPDTLGWSLLFLSQATLMPVRWTLHLVCQLGILVYYFGV ECCCCCHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCC NTALRLSTPAPNHPEIYNVTFILYIFWFCIICDLGVYLYDRLQRSEFYARKELESANNKL CCEEEECCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCE RLAEAKYRSIFENAIEGIFQSSPDGRYITANPALARIYGYTSPEEVTENFTDIEHQLYVD EEHHHHHHHHHHHHHHHHHCCCCCCCEEECCCHHHHHCCCCCHHHHHHHHHCCCCEEEEC PKRRAEFVRLMEESGLAPEFESQIYRQDGSVVWISEKAYAVRDEQGNLLYYEGLVEDITQ HHHHHHHHHHHHHCCCCCHHHHHHHHCCCCEEEEECCEEEEECCCCCEEEEHHHHHHHHH RKQAQEALRVFFHAVSHDLRNPVLGTLMVLRNLLNDEAGEAGKAEEAGGELTARFSPSPQ HHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHCCCCCCCCCCHHCCCCEEEEECCCCC SPIPSPQSPIPVPRSILKRMVQSSDRQLNLINSLLEAHIGEVQGLSLQCQPVQLQMVVEA CCCCCCCCCCCCCHHHHHHHHHCCCCHHHHHHHHHHHHHCCCCCCCEEECCHHHHHHHHH AIADLEPMLVDNQATLINLVTADLPLVNADPTQVWRVFSNFIVNAIKHNPPGLHLTINAI HHHCCCCEEECCCHHEEEEEECCCCCCCCCHHHHHHHHHHHHHHHHHCCCCCEEEEEEEC PQDDEIYCTVNDNGVGISQQQSDRLFDLYFRGGSIRNSLGLGLGLYLCKQIITAHGGEIG CCCCCEEEEECCCCCCCCCCCCCCEEEEEECCCCCHHHHHHHHHHHHHHHHHHHCCCCCC VKSGLEKGATFWFTLPMTSNQVNQL HHHCCCCCCEEEEEECCCCCHHCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: Phosphotransferases with a nitrogenous group as acceptor [C]
Inhibitor: NA
Structure determination priority: 6.0
TargetDB status: NA
Availability: NA
References: NA