Definition Nostoc sp. PCC 7120, complete genome.
Accession NC_003272
Length 6,413,771

Click here to switch to the map view.

The map label for this gene is sasA [H]

Identifier: 17231055

GI number: 17231055

Start: 4302339

End: 4304216

Strand: Reverse

Name: sasA [H]

Synonym: all3563

Alternate gene names: 17231055

Gene position: 4304216-4302339 (Counterclockwise)

Preceding gene: 17231056

Following gene: 17231052

Centisome position: 67.11

GC content: 43.24

Gene sequence:

>1878_bases
ATGACTACCTTTTTGATCAAATTGCAGAGGTTGTGGAGAAAGACTCTGTCTGCACTCACGTTAGATGAAATCACCACTGT
TTACCAAAATCGCTCTCAACAACAGGAATGGCTGGTAAATAGACAACGTTTTTTATGGCAGAGGCTACATCTGTGGTTAT
GGCTAGTACTAGGTTGTCTATTGACATTTACCCTCAGAAATGTGTACGACCTATTTTTTCCCCTCCGGGAGTTGAAGGCA
CTACCCCAGGTTTTGAGAACTCAAGGGCTAATGATCAATGCAGCTATGTTATTGAGCCTGCTGGTTTGTTTTACCCTGCA
TAAAACACGGTTTGGTCATCGCCATCCAGGTATTCTATTTTTAGGCTCATCTTGGTCGTTGAGTTTAGCATCACAGTTAT
TTGCCACCCTTAAAGGTTTTGCCTTACCCGATACCCTTGGCTGGTCATTACTATTTTTAAGTCAAGCTACACTTATGCCT
GTGCGCTGGACTCTGCATTTAGTTTGTCAGCTAGGGATTTTAGTTTACTACTTTGGTGTGAACACAGCTTTGAGGCTCAG
TACACCTGCACCGAACCATCCAGAAATATATAATGTTACGTTTATTCTCTACATCTTTTGGTTTTGTATTATATGTGATT
TAGGGGTTTACTTATACGATCGCCTGCAACGCTCTGAATTTTACGCCCGCAAAGAACTAGAGTCAGCCAACAATAAATTA
CGGCTAGCAGAAGCGAAATATCGCAGCATCTTTGAAAATGCCATTGAAGGTATTTTTCAAAGTAGCCCTGATGGACGTTA
CATTACAGCAAATCCTGCTTTAGCACGTATTTATGGTTACACTTCTCCCGAAGAAGTAACAGAAAATTTTACGGATATTG
AGCATCAATTATACGTTGACCCTAAACGCCGAGCCGAATTTGTCCGGTTGATGGAAGAATCTGGATTAGCTCCAGAATTT
GAGTCACAGATTTATCGTCAAGATGGCAGCGTTGTCTGGATTTCCGAAAAAGCCTACGCCGTTCGTGACGAACAAGGAAA
TCTCCTTTACTACGAAGGGTTGGTTGAAGATATTACCCAACGCAAACAAGCCCAAGAAGCACTGAGGGTCTTTTTCCATG
CGGTGTCCCATGACTTACGTAACCCAGTTTTAGGGACTTTGATGGTGTTGAGGAATTTACTTAATGACGAGGCAGGGGAA
GCAGGGAAAGCAGAGGAGGCAGGGGGAGAACTGACTGCAAGATTTTCGCCCAGTCCCCAGTCCCCAATCCCCAGTCCCCA
ATCCCCAATCCCTGTCCCTCGCTCAATTTTAAAGCGGATGGTGCAAAGTAGCGATCGCCAACTCAATCTGATTAACTCTT
TATTAGAAGCCCATATTGGTGAGGTGCAGGGTTTGAGCTTGCAATGTCAGCCTGTACAATTACAGATGGTGGTAGAAGCG
GCGATCGCAGATTTAGAACCCATGTTGGTAGATAATCAAGCCACTTTGATAAATTTAGTCACCGCAGATTTACCATTAGT
AAATGCCGATCCTACGCAAGTATGGCGAGTGTTTTCTAACTTCATCGTCAATGCCATCAAGCATAATCCCCCTGGATTAC
ACCTAACAATCAATGCTATTCCCCAAGATGACGAAATTTACTGCACTGTCAATGATAACGGTGTAGGCATCAGTCAACAA
CAGAGCGATCGGTTATTTGACCTTTATTTTCGGGGTGGTAGTATTCGTAATTCCTTGGGTTTAGGCTTGGGTTTATACCT
ATGTAAGCAAATCATCACTGCTCACGGCGGTGAAATTGGGGTAAAAAGTGGTTTAGAGAAAGGGGCTACATTCTGGTTTA
CGTTGCCCATGACATCAAATCAGGTTAACCAATTATAG

Upstream 100 bases:

>100_bases
CCTCACGATGAATTGTTCAACGTAAAAGCAGAATTGGTATTATGAAAGTCTGCAAATAGGAAACACCTACAATCGTATAG
GTGAAGTTGGTAAGGCTCTC

Downstream 100 bases:

>100_bases
TTTCTGCCCAGCATAGATTGATCGCACTTCACCATTACGCCGAACTATAGCTTCACCATTATTGACATCAACTAAAGTCC
AACCGCTAGCACCAATAGTT

Product: two-component sensor histidine kinase

Products: NA

Alternate protein names: Synechococcus adaptive sensor protein A [H]

Number of amino acids: Translated: 625; Mature: 624

Protein sequence:

>625_residues
MTTFLIKLQRLWRKTLSALTLDEITTVYQNRSQQQEWLVNRQRFLWQRLHLWLWLVLGCLLTFTLRNVYDLFFPLRELKA
LPQVLRTQGLMINAAMLLSLLVCFTLHKTRFGHRHPGILFLGSSWSLSLASQLFATLKGFALPDTLGWSLLFLSQATLMP
VRWTLHLVCQLGILVYYFGVNTALRLSTPAPNHPEIYNVTFILYIFWFCIICDLGVYLYDRLQRSEFYARKELESANNKL
RLAEAKYRSIFENAIEGIFQSSPDGRYITANPALARIYGYTSPEEVTENFTDIEHQLYVDPKRRAEFVRLMEESGLAPEF
ESQIYRQDGSVVWISEKAYAVRDEQGNLLYYEGLVEDITQRKQAQEALRVFFHAVSHDLRNPVLGTLMVLRNLLNDEAGE
AGKAEEAGGELTARFSPSPQSPIPSPQSPIPVPRSILKRMVQSSDRQLNLINSLLEAHIGEVQGLSLQCQPVQLQMVVEA
AIADLEPMLVDNQATLINLVTADLPLVNADPTQVWRVFSNFIVNAIKHNPPGLHLTINAIPQDDEIYCTVNDNGVGISQQ
QSDRLFDLYFRGGSIRNSLGLGLGLYLCKQIITAHGGEIGVKSGLEKGATFWFTLPMTSNQVNQL

Sequences:

>Translated_625_residues
MTTFLIKLQRLWRKTLSALTLDEITTVYQNRSQQQEWLVNRQRFLWQRLHLWLWLVLGCLLTFTLRNVYDLFFPLRELKA
LPQVLRTQGLMINAAMLLSLLVCFTLHKTRFGHRHPGILFLGSSWSLSLASQLFATLKGFALPDTLGWSLLFLSQATLMP
VRWTLHLVCQLGILVYYFGVNTALRLSTPAPNHPEIYNVTFILYIFWFCIICDLGVYLYDRLQRSEFYARKELESANNKL
RLAEAKYRSIFENAIEGIFQSSPDGRYITANPALARIYGYTSPEEVTENFTDIEHQLYVDPKRRAEFVRLMEESGLAPEF
ESQIYRQDGSVVWISEKAYAVRDEQGNLLYYEGLVEDITQRKQAQEALRVFFHAVSHDLRNPVLGTLMVLRNLLNDEAGE
AGKAEEAGGELTARFSPSPQSPIPSPQSPIPVPRSILKRMVQSSDRQLNLINSLLEAHIGEVQGLSLQCQPVQLQMVVEA
AIADLEPMLVDNQATLINLVTADLPLVNADPTQVWRVFSNFIVNAIKHNPPGLHLTINAIPQDDEIYCTVNDNGVGISQQ
QSDRLFDLYFRGGSIRNSLGLGLGLYLCKQIITAHGGEIGVKSGLEKGATFWFTLPMTSNQVNQL
>Mature_624_residues
TTFLIKLQRLWRKTLSALTLDEITTVYQNRSQQQEWLVNRQRFLWQRLHLWLWLVLGCLLTFTLRNVYDLFFPLRELKAL
PQVLRTQGLMINAAMLLSLLVCFTLHKTRFGHRHPGILFLGSSWSLSLASQLFATLKGFALPDTLGWSLLFLSQATLMPV
RWTLHLVCQLGILVYYFGVNTALRLSTPAPNHPEIYNVTFILYIFWFCIICDLGVYLYDRLQRSEFYARKELESANNKLR
LAEAKYRSIFENAIEGIFQSSPDGRYITANPALARIYGYTSPEEVTENFTDIEHQLYVDPKRRAEFVRLMEESGLAPEFE
SQIYRQDGSVVWISEKAYAVRDEQGNLLYYEGLVEDITQRKQAQEALRVFFHAVSHDLRNPVLGTLMVLRNLLNDEAGEA
GKAEEAGGELTARFSPSPQSPIPSPQSPIPVPRSILKRMVQSSDRQLNLINSLLEAHIGEVQGLSLQCQPVQLQMVVEAA
IADLEPMLVDNQATLINLVTADLPLVNADPTQVWRVFSNFIVNAIKHNPPGLHLTINAIPQDDEIYCTVNDNGVGISQQQ
SDRLFDLYFRGGSIRNSLGLGLGLYLCKQIITAHGGEIGVKSGLEKGATFWFTLPMTSNQVNQL

Specific function: May be involved in signal transduction. Participates in the kaiABC clock protein complex, which constitutes the main circadian regulator in cyanobacteria, via its interaction with kaiC. Required for robustness of the circadian rhythm of gene expression an

COG id: NA

COG function: NA

Gene ontology:

Cell location: Integral Membrane Protein. Inner Membrane [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 histidine kinase domain [H]

Homologues:

Organism=Escherichia coli, GI145693157, Length=276, Percent_Identity=27.8985507246377, Blast_Score=91, Evalue=3e-19,
Organism=Escherichia coli, GI1786912, Length=259, Percent_Identity=30.5019305019305, Blast_Score=85, Evalue=1e-17,
Organism=Escherichia coli, GI48994928, Length=415, Percent_Identity=24.3373493975904, Blast_Score=82, Evalue=9e-17,
Organism=Escherichia coli, GI1786600, Length=267, Percent_Identity=25.0936329588015, Blast_Score=82, Evalue=1e-16,
Organism=Escherichia coli, GI1788549, Length=369, Percent_Identity=25.2032520325203, Blast_Score=77, Evalue=5e-15,
Organism=Escherichia coli, GI1789149, Length=270, Percent_Identity=26.6666666666667, Blast_Score=74, Evalue=2e-14,
Organism=Escherichia coli, GI1790436, Length=264, Percent_Identity=25.3787878787879, Blast_Score=73, Evalue=6e-14,
Organism=Escherichia coli, GI1788713, Length=120, Percent_Identity=34.1666666666667, Blast_Score=68, Evalue=2e-12,
Organism=Escherichia coli, GI1788393, Length=261, Percent_Identity=24.5210727969349, Blast_Score=67, Evalue=2e-12,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR003594
- InterPro:   IPR011649
- InterPro:   IPR004358
- InterPro:   IPR003661
- InterPro:   IPR005467
- InterPro:   IPR009082
- InterPro:   IPR012336
- InterPro:   IPR012335 [H]

Pfam domain/function: PF02518 HATPase_c; PF00512 HisKA; PF07689 KaiB [H]

EC number: 2.7.3.- [C]

Molecular weight: Translated: 70925; Mature: 70794

Theoretical pI: Translated: 6.70; Mature: 6.70

Prosite motif: PS50112 PAS ; PS50113 PAC ; PS50109 HIS_KIN

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.3 %Cys     (Translated Protein)
1.6 %Met     (Translated Protein)
2.9 %Cys+Met (Translated Protein)
1.3 %Cys     (Mature Protein)
1.4 %Met     (Mature Protein)
2.7 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MTTFLIKLQRLWRKTLSALTLDEITTVYQNRSQQQEWLVNRQRFLWQRLHLWLWLVLGCL
CCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHH
LTFTLRNVYDLFFPLRELKALPQVLRTQGLMINAAMLLSLLVCFTLHKTRFGHRHPGILF
HHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCEEE
LGSSWSLSLASQLFATLKGFALPDTLGWSLLFLSQATLMPVRWTLHLVCQLGILVYYFGV
ECCCCCHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCC
NTALRLSTPAPNHPEIYNVTFILYIFWFCIICDLGVYLYDRLQRSEFYARKELESANNKL
CCEEEECCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCE
RLAEAKYRSIFENAIEGIFQSSPDGRYITANPALARIYGYTSPEEVTENFTDIEHQLYVD
EEHHHHHHHHHHHHHHHHHCCCCCCCEEECCCHHHHHCCCCCHHHHHHHHHCCCCEEEEC
PKRRAEFVRLMEESGLAPEFESQIYRQDGSVVWISEKAYAVRDEQGNLLYYEGLVEDITQ
HHHHHHHHHHHHHCCCCCHHHHHHHHCCCCEEEEECCEEEEECCCCCEEEEHHHHHHHHH
RKQAQEALRVFFHAVSHDLRNPVLGTLMVLRNLLNDEAGEAGKAEEAGGELTARFSPSPQ
HHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHCCCCCCCCCCHHCCCCEEEEECCCCC
SPIPSPQSPIPVPRSILKRMVQSSDRQLNLINSLLEAHIGEVQGLSLQCQPVQLQMVVEA
CCCCCCCCCCCCCHHHHHHHHHCCCCHHHHHHHHHHHHHCCCCCCCEEECCHHHHHHHHH
AIADLEPMLVDNQATLINLVTADLPLVNADPTQVWRVFSNFIVNAIKHNPPGLHLTINAI
HHHCCCCEEECCCHHEEEEEECCCCCCCCCHHHHHHHHHHHHHHHHHCCCCCEEEEEEEC
PQDDEIYCTVNDNGVGISQQQSDRLFDLYFRGGSIRNSLGLGLGLYLCKQIITAHGGEIG
CCCCCEEEEECCCCCCCCCCCCCCEEEEEECCCCCHHHHHHHHHHHHHHHHHHHCCCCCC
VKSGLEKGATFWFTLPMTSNQVNQL
HHHCCCCCCEEEEEECCCCCHHCCC
>Mature Secondary Structure 
TTFLIKLQRLWRKTLSALTLDEITTVYQNRSQQQEWLVNRQRFLWQRLHLWLWLVLGCL
CHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHH
LTFTLRNVYDLFFPLRELKALPQVLRTQGLMINAAMLLSLLVCFTLHKTRFGHRHPGILF
HHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCEEE
LGSSWSLSLASQLFATLKGFALPDTLGWSLLFLSQATLMPVRWTLHLVCQLGILVYYFGV
ECCCCCHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCC
NTALRLSTPAPNHPEIYNVTFILYIFWFCIICDLGVYLYDRLQRSEFYARKELESANNKL
CCEEEECCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCE
RLAEAKYRSIFENAIEGIFQSSPDGRYITANPALARIYGYTSPEEVTENFTDIEHQLYVD
EEHHHHHHHHHHHHHHHHHCCCCCCCEEECCCHHHHHCCCCCHHHHHHHHHCCCCEEEEC
PKRRAEFVRLMEESGLAPEFESQIYRQDGSVVWISEKAYAVRDEQGNLLYYEGLVEDITQ
HHHHHHHHHHHHHCCCCCHHHHHHHHCCCCEEEEECCEEEEECCCCCEEEEHHHHHHHHH
RKQAQEALRVFFHAVSHDLRNPVLGTLMVLRNLLNDEAGEAGKAEEAGGELTARFSPSPQ
HHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHCCCCCCCCCCHHCCCCEEEEECCCCC
SPIPSPQSPIPVPRSILKRMVQSSDRQLNLINSLLEAHIGEVQGLSLQCQPVQLQMVVEA
CCCCCCCCCCCCCHHHHHHHHHCCCCHHHHHHHHHHHHHCCCCCCCEEECCHHHHHHHHH
AIADLEPMLVDNQATLINLVTADLPLVNADPTQVWRVFSNFIVNAIKHNPPGLHLTINAI
HHHCCCCEEECCCHHEEEEEECCCCCCCCCHHHHHHHHHHHHHHHHHCCCCCEEEEEEEC
PQDDEIYCTVNDNGVGISQQQSDRLFDLYFRGGSIRNSLGLGLGLYLCKQIITAHGGEIG
CCCCCEEEEECCCCCCCCCCCCCCEEEEEECCCCCHHHHHHHHHHHHHHHHHHHCCCCCC
VKSGLEKGATFWFTLPMTSNQVNQL
HHHCCCCCCEEEEEECCCCCHHCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: Phosphotransferases with a nitrogenous group as acceptor [C]

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: NA