Definition Erythrobacter litoralis HTCC2594 chromosome, complete genome.
Accession NC_007722
Length 3,052,398

Click here to switch to the map view.

The map label for this gene is atoS [C]

Identifier: 85374374

GI number: 85374374

Start: 1602234

End: 1604678

Strand: Reverse

Name: atoS [C]

Synonym: ELI_07735

Alternate gene names: 85374374

Gene position: 1604678-1602234 (Counterclockwise)

Preceding gene: 85374375

Following gene: 85374373

Centisome position: 52.57

GC content: 66.05

Gene sequence:

>2445_bases
ATGAAGGGCTTCGACGCAGAGAGCGCAGCTGCCCGCATACCACCTTTCTGGCTGATCCTCGGTGCCGCGCTGCTGGTGAG
CATCGGGGCCGTTTGGGCTCTCAGCGGGCTGGCATTGCTGACGGTCGCCTATGCCGGCGGGCTGGCGACCCTGTTGGCCC
TGGTATTCACCTTGGCGCGGGTGCGTAACGAAGCGGGCGAGGCCGAGCTTGCCCCGCCCGACTGGTCGGTCACCGTCGCG
GCGATCGAACGGCCCGATGTGGCGGTGGCGATTACGGACCGCGCCAACCGCCTTGTCTGTGCCAGCTCGCTGTTCGCGGA
GCAGCTGGGTGTCGGCAAGGCACCGCCCAATCTCAGCGTGGACCAGCCTTCGCTCGAAGCACTCACCCGCGTCGCGCGCG
AGGCCTGGCGAGACGGCACGGCATCGGTCGGGTCGGTCGCCAGTGCCGACGGTGCGCGCAGCTGGCACGTGGAGGCGCAG
CGCGCCGGGCGCGGCGACGATTACCTGGTTTGGCGCTTCGCTTCGCTGGTCGCCGACGATGCGACCGGCTCGCTCGCATC
CCAGCTGACCGGCGTGCTTGGCGCGATGCTGTCCCGCGCCGGGGTCGAGAGCGTGCTGATTGCGCCCGATGGAACGGTCA
ATGCGGCAAGTCCCGGGTTCGCCGAGCGCGCAACGGGCGATCCCAAGGCGACGCTGGCAGGCCGGGAATTCGTAACCTTG
CTGCGCAGCGACGAAAAGGATCGCATCTATTTCGCGCGCGAAGGCAAGCGCGGCACGCCGCATGCGCTGGTCCATGTCCC
ACTCAACGATCCGGACGATCCCGCCGGTGCGAGCGCCGATGCGGCACCTTCGCTGATGCTGCTGATGGAGCAGGGCATCG
CCATGGGCGCGGCAGAGGAACCTGGCGCGAGCAATGCTACGCCGCAACTGGAGGCGCTGGTCGGCGCTTTGCCACTCGGG
TTGGCCATGACCGACCGCGACGGACGCTTCCTGTTCGCCAATCCGAGCTTCCTGCGCGCGATCGAGCGCGAGGAGCAGGG
CCTGCCGCAATATCCGTCCGATCTTGTGGTAAAGGAGGACAAGAGCGCGCTTGCCGACGCGGTGCGGCGGTATGCGAAGG
GCCCCGCCAACAGCGGGGATATGGCGGTGCGCCTGCGCACGGCGCCCGAAGAACCGGTCTCGCTCGGCCTCTCGGGCGTG
CGCGGCCTCGGCGATGCGGCGGTTTTGCTCAGCCTCGCCGACAGCACGGAAGAGACCAGGCTCAAGCGTCAGGTCGCGCA
GGCGACCAAGATGCAGGCGGTCGGCCAGCTCGCCGGCGGCGTCGCGCATGACTTCAACAATGTTCTGACCGCGATCATCG
GCTATTGCGATCTCATGCTGCTGCGCCACACGCCCGGCGACAGCGATTACGACGATATCCAGCAGATCCTCGCCAATTCC
AATCGCGCCGCCAGCCTGACGCGGCAATTGCTTGCCTTCAGCCGCCAGCAGACATTGCGGCCCGAAGTGCTGCAACTGCC
CGACGTCGTGAGCGAAGTGCACCAGCTTCTCAAGCGGCTCGTCGGCGAGAAGATCGAGTTCAGCGTCCGTCATGATCGCG
ACCTCGGCCCTGTCCGCGCCGATCCGCGCCAGCTGGAACAGGTCATCATCAACCTCGCGGTCAATGCCCGCGATGCGATC
CAGTCTCATGGCGTGGCCAACGGACGCCTGACGATGGCGACGCGGCGCGTATCGGCCAGGGACGTGCGCGGTATGGGCTC
CGACATCCTGCCGCTGGCGGACTATACCGCGCTGATCGTGCAGGACACGGGAGGTGGCATTCCGGAAGATGTGCTGCCGA
AAATCTTCGAGCCGTTTTTTACGACCAAGGAGCAGGGGAAAGGCACGGGGCTGGGCCTCTCGACGGTTTACGGGATCGTC
AAGCAATCGGGCGGCTTCATCTTTGCCGACAATGTGGCCGGGCCGGGCGGCAAGGCCACCGGCGCGCGTTTTACGATCTA
TCTACCGGTGCATCATGGCGAGGTACCGCAAGCCGCCCGCGAAGAAGACGCGCCTCCTGCCAGCGAGTGGTCGGGAGGAG
CACGGCTTCTGCTGGTCGAAGACGAGGACATGGTTCGCACCGTGGCCGAGCGCGCGCTGACGCGGGCAGGCCATACGGTA
ACCTCTTGCGCCGACGGTGAAATGGGCTTTGCGGCGATCGCCAATGGCGGTGCATTCGATCTCGTCGTCTCCGATGTCGT
GATGCCGGGGATGGATGGCCCGGCAATGGCGCGCGCGATTCGCAAGGTCGCGCCCGACATCCCGATCCTGTTCATGTCGG
GCTATGCCGAGGAACAACTGCGCAAGGATATCGACATCCACAATATGCACTTCCTTCCCAAACCCTTCAGCGTGCAACAG
ATCTCGCAGAAAGTCGCGGAAGTGCTGGGTGCAAAGACGCGCTAG

Upstream 100 bases:

>100_bases
TCGCCAGCTGGTGGTGGACCCGCCGCGTCCACGCCAAGCGCGCCAAGCGGCTGCGCCAGATGGAGCAGCGGCTCGACGAA
CGGCTGCAGGCTGGCCGCGG

Downstream 100 bases:

>100_bases
AGCACAAGCGGCCGTCGCCTGCGGCCGACCTGTTTGATCCGATACAGAGAAAAAATTTCGTTCCCCCCTTGTTCCACCAG
AACAAAAGCGATACATGATG

Product: two-component response regulator

Products: NA

Alternate protein names: Blue-light-activated histidine kinase; Response regulator [H]

Number of amino acids: Translated: 814; Mature: 814

Protein sequence:

>814_residues
MKGFDAESAAARIPPFWLILGAALLVSIGAVWALSGLALLTVAYAGGLATLLALVFTLARVRNEAGEAELAPPDWSVTVA
AIERPDVAVAITDRANRLVCASSLFAEQLGVGKAPPNLSVDQPSLEALTRVAREAWRDGTASVGSVASADGARSWHVEAQ
RAGRGDDYLVWRFASLVADDATGSLASQLTGVLGAMLSRAGVESVLIAPDGTVNAASPGFAERATGDPKATLAGREFVTL
LRSDEKDRIYFAREGKRGTPHALVHVPLNDPDDPAGASADAAPSLMLLMEQGIAMGAAEEPGASNATPQLEALVGALPLG
LAMTDRDGRFLFANPSFLRAIEREEQGLPQYPSDLVVKEDKSALADAVRRYAKGPANSGDMAVRLRTAPEEPVSLGLSGV
RGLGDAAVLLSLADSTEETRLKRQVAQATKMQAVGQLAGGVAHDFNNVLTAIIGYCDLMLLRHTPGDSDYDDIQQILANS
NRAASLTRQLLAFSRQQTLRPEVLQLPDVVSEVHQLLKRLVGEKIEFSVRHDRDLGPVRADPRQLEQVIINLAVNARDAI
QSHGVANGRLTMATRRVSARDVRGMGSDILPLADYTALIVQDTGGGIPEDVLPKIFEPFFTTKEQGKGTGLGLSTVYGIV
KQSGGFIFADNVAGPGGKATGARFTIYLPVHHGEVPQAAREEDAPPASEWSGGARLLLVEDEDMVRTVAERALTRAGHTV
TSCADGEMGFAAIANGGAFDLVVSDVVMPGMDGPAMARAIRKVAPDIPILFMSGYAEEQLRKDIDIHNMHFLPKPFSVQQ
ISQKVAEVLGAKTR

Sequences:

>Translated_814_residues
MKGFDAESAAARIPPFWLILGAALLVSIGAVWALSGLALLTVAYAGGLATLLALVFTLARVRNEAGEAELAPPDWSVTVA
AIERPDVAVAITDRANRLVCASSLFAEQLGVGKAPPNLSVDQPSLEALTRVAREAWRDGTASVGSVASADGARSWHVEAQ
RAGRGDDYLVWRFASLVADDATGSLASQLTGVLGAMLSRAGVESVLIAPDGTVNAASPGFAERATGDPKATLAGREFVTL
LRSDEKDRIYFAREGKRGTPHALVHVPLNDPDDPAGASADAAPSLMLLMEQGIAMGAAEEPGASNATPQLEALVGALPLG
LAMTDRDGRFLFANPSFLRAIEREEQGLPQYPSDLVVKEDKSALADAVRRYAKGPANSGDMAVRLRTAPEEPVSLGLSGV
RGLGDAAVLLSLADSTEETRLKRQVAQATKMQAVGQLAGGVAHDFNNVLTAIIGYCDLMLLRHTPGDSDYDDIQQILANS
NRAASLTRQLLAFSRQQTLRPEVLQLPDVVSEVHQLLKRLVGEKIEFSVRHDRDLGPVRADPRQLEQVIINLAVNARDAI
QSHGVANGRLTMATRRVSARDVRGMGSDILPLADYTALIVQDTGGGIPEDVLPKIFEPFFTTKEQGKGTGLGLSTVYGIV
KQSGGFIFADNVAGPGGKATGARFTIYLPVHHGEVPQAAREEDAPPASEWSGGARLLLVEDEDMVRTVAERALTRAGHTV
TSCADGEMGFAAIANGGAFDLVVSDVVMPGMDGPAMARAIRKVAPDIPILFMSGYAEEQLRKDIDIHNMHFLPKPFSVQQ
ISQKVAEVLGAKTR
>Mature_814_residues
MKGFDAESAAARIPPFWLILGAALLVSIGAVWALSGLALLTVAYAGGLATLLALVFTLARVRNEAGEAELAPPDWSVTVA
AIERPDVAVAITDRANRLVCASSLFAEQLGVGKAPPNLSVDQPSLEALTRVAREAWRDGTASVGSVASADGARSWHVEAQ
RAGRGDDYLVWRFASLVADDATGSLASQLTGVLGAMLSRAGVESVLIAPDGTVNAASPGFAERATGDPKATLAGREFVTL
LRSDEKDRIYFAREGKRGTPHALVHVPLNDPDDPAGASADAAPSLMLLMEQGIAMGAAEEPGASNATPQLEALVGALPLG
LAMTDRDGRFLFANPSFLRAIEREEQGLPQYPSDLVVKEDKSALADAVRRYAKGPANSGDMAVRLRTAPEEPVSLGLSGV
RGLGDAAVLLSLADSTEETRLKRQVAQATKMQAVGQLAGGVAHDFNNVLTAIIGYCDLMLLRHTPGDSDYDDIQQILANS
NRAASLTRQLLAFSRQQTLRPEVLQLPDVVSEVHQLLKRLVGEKIEFSVRHDRDLGPVRADPRQLEQVIINLAVNARDAI
QSHGVANGRLTMATRRVSARDVRGMGSDILPLADYTALIVQDTGGGIPEDVLPKIFEPFFTTKEQGKGTGLGLSTVYGIV
KQSGGFIFADNVAGPGGKATGARFTIYLPVHHGEVPQAAREEDAPPASEWSGGARLLLVEDEDMVRTVAERALTRAGHTV
TSCADGEMGFAAIANGGAFDLVVSDVVMPGMDGPAMARAIRKVAPDIPILFMSGYAEEQLRKDIDIHNMHFLPKPFSVQQ
ISQKVAEVLGAKTR

Specific function: Photosensitive kinase and response regulator that is involved in increased bacterial virulence upon exposure to light [H]

COG id: COG0642

COG function: function code T; Signal transduction histidine kinase

Gene ontology:

Cell location: Integral Membrane Protein. Inner Membrane [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 response regulatory domain [H]

Homologues:

Organism=Escherichia coli, GI1788549, Length=265, Percent_Identity=31.3207547169811, Blast_Score=107, Evalue=2e-24,
Organism=Escherichia coli, GI1790436, Length=252, Percent_Identity=32.9365079365079, Blast_Score=106, Evalue=5e-24,
Organism=Escherichia coli, GI1790300, Length=275, Percent_Identity=28.3636363636364, Blast_Score=79, Evalue=8e-16,
Organism=Escherichia coli, GI48994928, Length=241, Percent_Identity=31.9502074688797, Blast_Score=79, Evalue=1e-15,
Organism=Escherichia coli, GI87081816, Length=394, Percent_Identity=22.3350253807107, Blast_Score=72, Evalue=1e-13,
Organism=Escherichia coli, GI145693157, Length=333, Percent_Identity=24.6246246246246, Blast_Score=70, Evalue=5e-13,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR003594
- InterPro:   IPR011006
- InterPro:   IPR001610
- InterPro:   IPR000014
- InterPro:   IPR000700
- InterPro:   IPR013767
- InterPro:   IPR004358
- InterPro:   IPR003661
- InterPro:   IPR005467
- InterPro:   IPR009082
- InterPro:   IPR001789 [H]

Pfam domain/function: PF02518 HATPase_c; PF00512 HisKA; PF00989 PAS; PF00072 Response_reg [H]

EC number: =2.7.13.3 [H]

Molecular weight: Translated: 86191; Mature: 86191

Theoretical pI: Translated: 5.09; Mature: 5.09

Prosite motif: PS50110 RESPONSE_REGULATORY ; PS50109 HIS_KIN

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.4 %Cys     (Translated Protein)
2.2 %Met     (Translated Protein)
2.6 %Cys+Met (Translated Protein)
0.4 %Cys     (Mature Protein)
2.2 %Met     (Mature Protein)
2.6 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKGFDAESAAARIPPFWLILGAALLVSIGAVWALSGLALLTVAYAGGLATLLALVFTLAR
CCCCCCCCHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
VRNEAGEAELAPPDWSVTVAAIERPDVAVAITDRANRLVCASSLFAEQLGVGKAPPNLSV
HHHCCCCCCCCCCCCCEEEEEECCCCEEEEEECCCCCCHHHHHHHHHHHCCCCCCCCCCC
DQPSLEALTRVAREAWRDGTASVGSVASADGARSWHVEAQRAGRGDDYLVWRFASLVADD
CCHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCEEEEEHHHCCCCCCHHHHHHHHHHHCC
ATGSLASQLTGVLGAMLSRAGVESVLIAPDGTVNAASPGFAERATGDPKATLAGREFVTL
CCHHHHHHHHHHHHHHHHHCCCCEEEECCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHH
LRSDEKDRIYFAREGKRGTPHALVHVPLNDPDDPAGASADAAPSLMLLMEQGIAMGAAEE
HHCCCCCEEEEEECCCCCCCCEEEEEECCCCCCCCCCCCCCCHHHHHHHHCCCCCCCCCC
PGASNATPQLEALVGALPLGLAMTDRDGRFLFANPSFLRAIEREEQGLPQYPSDLVVKED
CCCCCCCHHHHHHHHHHHCCEEEECCCCEEEEECHHHHHHHHHHHCCCCCCCCCCEEECH
KSALADAVRRYAKGPANSGDMAVRLRTAPEEPVSLGLSGVRGLGDAAVLLSLADSTEETR
HHHHHHHHHHHHCCCCCCCCEEEEEECCCCCHHHHCCHHHCCCCCHHHHHHHHCCHHHHH
LKRQVAQATKMQAVGQLAGGVAHDFNNVLTAIIGYCDLMLLRHTPGDSDYDDIQQILANS
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHCC
NRAASLTRQLLAFSRQQTLRPEVLQLPDVVSEVHQLLKRLVGEKIEFSVRHDRDLGPVRA
CHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHCCCCEEEEECCCCCCCCCCC
DPRQLEQVIINLAVNARDAIQSHGVANGRLTMATRRVSARDVRGMGSDILPLADYTALIV
CHHHHHHHHHHHHCCHHHHHHHCCCCCCEEEEHHHHHHHHHHHCCCCCCCCCCCCEEEEE
QDTGGGIPEDVLPKIFEPFFTTKEQGKGTGLGLSTVYGIVKQSGGFIFADNVAGPGGKAT
ECCCCCCCHHHHHHHHHHHHCCCCCCCCCCCCHHHHHHHHHCCCCEEEECCCCCCCCCCC
GARFTIYLPVHHGEVPQAAREEDAPPASEWSGGARLLLVEDEDMVRTVAERALTRAGHTV
CCEEEEEEEEECCCCCCHHHHCCCCCCCCCCCCEEEEEECCHHHHHHHHHHHHHHCCCCE
TSCADGEMGFAAIANGGAFDLVVSDVVMPGMDGPAMARAIRKVAPDIPILFMSGYAEEQL
EECCCCCCCEEEEECCCCHHHHHHHHHCCCCCCHHHHHHHHHHCCCCCEEEECCCHHHHH
RKDIDIHNMHFLPKPFSVQQISQKVAEVLGAKTR
HHCCCCCCEECCCCCCCHHHHHHHHHHHHCCCCC
>Mature Secondary Structure
MKGFDAESAAARIPPFWLILGAALLVSIGAVWALSGLALLTVAYAGGLATLLALVFTLAR
CCCCCCCCHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
VRNEAGEAELAPPDWSVTVAAIERPDVAVAITDRANRLVCASSLFAEQLGVGKAPPNLSV
HHHCCCCCCCCCCCCCEEEEEECCCCEEEEEECCCCCCHHHHHHHHHHHCCCCCCCCCCC
DQPSLEALTRVAREAWRDGTASVGSVASADGARSWHVEAQRAGRGDDYLVWRFASLVADD
CCHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCEEEEEHHHCCCCCCHHHHHHHHHHHCC
ATGSLASQLTGVLGAMLSRAGVESVLIAPDGTVNAASPGFAERATGDPKATLAGREFVTL
CCHHHHHHHHHHHHHHHHHCCCCEEEECCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHH
LRSDEKDRIYFAREGKRGTPHALVHVPLNDPDDPAGASADAAPSLMLLMEQGIAMGAAEE
HHCCCCCEEEEEECCCCCCCCEEEEEECCCCCCCCCCCCCCCHHHHHHHHCCCCCCCCCC
PGASNATPQLEALVGALPLGLAMTDRDGRFLFANPSFLRAIEREEQGLPQYPSDLVVKED
CCCCCCCHHHHHHHHHHHCCEEEECCCCEEEEECHHHHHHHHHHHCCCCCCCCCCEEECH
KSALADAVRRYAKGPANSGDMAVRLRTAPEEPVSLGLSGVRGLGDAAVLLSLADSTEETR
HHHHHHHHHHHHCCCCCCCCEEEEEECCCCCHHHHCCHHHCCCCCHHHHHHHHCCHHHHH
LKRQVAQATKMQAVGQLAGGVAHDFNNVLTAIIGYCDLMLLRHTPGDSDYDDIQQILANS
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHCC
NRAASLTRQLLAFSRQQTLRPEVLQLPDVVSEVHQLLKRLVGEKIEFSVRHDRDLGPVRA
CHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHCCCCEEEEECCCCCCCCCCC
DPRQLEQVIINLAVNARDAIQSHGVANGRLTMATRRVSARDVRGMGSDILPLADYTALIV
CHHHHHHHHHHHHCCHHHHHHHCCCCCCEEEEHHHHHHHHHHHCCCCCCCCCCCCEEEEE
QDTGGGIPEDVLPKIFEPFFTTKEQGKGTGLGLSTVYGIVKQSGGFIFADNVAGPGGKAT
ECCCCCCCHHHHHHHHHHHHCCCCCCCCCCCCHHHHHHHHHCCCCEEEECCCCCCCCCCC
GARFTIYLPVHHGEVPQAAREEDAPPASEWSGGARLLLVEDEDMVRTVAERALTRAGHTV
CCEEEEEEEEECCCCCCHHHHCCCCCCCCCCCCEEEEEECCHHHHHHHHHHHHHHCCCCE
TSCADGEMGFAAIANGGAFDLVVSDVVMPGMDGPAMARAIRKVAPDIPILFMSGYAEEQL
EECCCCCCCEEEEECCCCHHHHHHHHHCCCCCCHHHHHHHHHHCCCCCEEEECCCHHHHH
RKDIDIHNMHFLPKPFSVQQISQKVAEVLGAKTR
HHCCCCCCEECCCCCCCHHHHHHHHHHHHCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: NA