Definition Acaryochloris marina MBIC11017 chromosome, complete genome.
Accession NC_009925
Length 6,503,724

Click here to switch to the map view.

The map label for this gene is frzE [H]

Identifier: 158338184

GI number: 158338184

Start: 5128201

End: 5130534

Strand: Reverse

Name: frzE [H]

Synonym: AM1_5077

Alternate gene names: 158338184

Gene position: 5130534-5128201 (Counterclockwise)

Preceding gene: 158338185

Following gene: 158338183

Centisome position: 78.89

GC content: 49.4

Gene sequence:

>2334_bases
ATGTTCATCGAAGATGACGAACTGCGTGGACTTTACAAAGCTGCCAGTGCCGAACATATCGAAACCATAGAAGCAGGTTT
GCTCCATTTGGAAAAAAACCCAGAGGATCAACAGCAGTTACAAGCACTCCTAAGAGCAACCCATTCCCTTAAGGGGGATT
CGCGGATGCTGGGGGTTGGTGATGCCGAGACCGTTACTCATCAGATGGAGGATCTTTTGTCTGAGGTTGAGCAAGGGGAT
CGAATTTTATCGTCTGGGTTATGCGATCTCCTTTACTCTGGTTTGGATGCAGTTCGTAAAATTGCCCATACGGCAGTGAC
TGGGGAACAGACAGATGTGAGTGTTTTCCACGTCATGGCCCAGTTGATGGCTGGCGATGATGCGGACATTCCTTCAGGGC
CTGCAGCGACCCTAGATATCATTCAAGGGGATGAAACTGTAGAGATTGACCCTGCTGCCACCTTGATACAAGTCGCGGAA
GAGACTGAGCCCGATTTAGCGGCTGAACTGAATCAACTTCTCAAACAATCTCCCTCCGATCAGGGACAATCTAAGCCCGC
TGAAACACCGACCACCTCTCCTTATCAGGTGGATACCGTGCGGGTAGAGGCAGCCAAGCTGGATCAATTGATGACTCAGG
CGAGTGAGTTGGCTGTTACGAAACTTCGAATTGCCCAGAGACTTGGGGAAGTGGAACAATTAGCCACCCTTAGGGAGCAA
TGGACCACTGATTTACAGGCCCAACAGTTGAGTTTAACGCCGCTAAAACAGCAACTCTCTGCGGCCGATGCCATGTTGGT
GGATCAGGTCTTGCAAGTTCATCAACAGCGGCTCTCAGCCCTCAGTTTTCAGATTGAAAATCTAAAGGCCCAAGTGGGAG
AAGATTCAACTCGCTTGGATATTACGGCTAACCAATTAGAAGTCGGCATTCGCAATTTGCGCATGTTGCCCGTGGCCGGT
CTATTTCAACTTTTCCCTCGCATGGTGCGGGATCTTGCCAAACAACAGCAAAAACAGATTGAGCTGGTTCTAGAAGGCAC
AGATACCCTGGCAGATAAAAACATCTTGGAACAGATGCAGGCTCCCTTAACCCACTTAGTTCGCAATGCCATCGACCATG
GCATCGAGACTACAGCCGAACGAATGGCGATGGGTAAGTCGGAAACAGCTACCCTCCGCTTAAGGGCGTATCAATTGGGC
AGTAGTATTGCCATTGAACTCACGGACGATGGCCGAGGGTTGGAGCTGACCAAGATCCAAGAGACGGCCATTAGACGAGG
GCTACATACTGAGACCGAGTTAGCCCGCATGACCACCAGCCAAGTCCAGTCTCTGATCTTTGCACCCGGTTTTTCGACGC
GGACCCAAGTGACAGAGATTTCGGGGCGAGGGGTCGGCTTGGATGTGGTCCGAGCCAACGTGGAGCGACTACAAGGCACC
ATTCAAGTTCGTTCGATTCCTAGCCAGGGCTGCACCTTTCAGCTCACTCTCAGCTCTAGCTTAACCACCACTGCAGTCCT
TATTGTTGAGGTAAATCAGCATCCTTACGCGATTCCCTTGGAATATGTGGACAAGATGATCAGTGTCACCCCTGACCAAA
TCTTTTCGTTGGAAGGGCATCCTACTATTACGGATCAAGACCAACCCTTATCTGTAATGTGGCTAAGTGATGTTCTTGAA
TTACCAACCGAACAGGATAGACACGAAACTGAACGCACCAATATTCCTTGTGTCATTCTCCAAATTGGTTCAGAACGCTT
GGGGTTATTTATCGATCAACTCGTAGATCAGCAGGATATTGTGCTAAAACCCCAGAGTAAATTGCTGAAACGCATTCGGA
ATATCACCGGGGCCACTATCTTGGGCAATGGTGAGATCTGTATGGTACTCAATCCCCAAGATTTCCTACAAGCCACCCAA
GGCATGGACGATCTCACCTTGTCCGAACATTTACATGAAGCCGTGACATCAAAGGTGTTGTTGGTTGAAGATTCCATACC
AATCCGAACGCAAATGAAACGGATTCTACAAGGGGCTGGGTATGACGTCACTGCTGCAGTAGACGGTCAAGAGGGATTGG
AGAAGCTGCAGGCTGATCGCTTTGATGCGGTGGTGTCTGATGTGGAAATGCCCAATTTAACTGGACTAGAAATGACGGCC
CAGATTCGTCAGAGACAGGAATACCAGCAGCTTCCCATTGTATTGGTCACAACCCTAGCGAAGGAAGAAGACAAACGTCG
CGGTCAGGAAGCGGGGGCCAACGCTTACCTAACCAAAGGTGATTTTGATCAAACATTGCTTATCGAGACCTTAAGGAGGT
TAATTGCGTCATGA

Upstream 100 bases:

>100_bases
TTTTAGGAAAGAAACCCTTGATTGTCTGGGATCTTTCGACTCCAAAGCGAAAGCTCTTTCCTGCTTTTCCCCACCCTTTA
TCTAAGCAAGCATAACAACC

Downstream 100 bases:

>100_bases
CAGATCCGATCAAAGTAGTCCTAGTTGAAGATTCTGCAGTTGCCCTCCAGATTCTCAGTCGATTGCTGGATTCTGCCCCA
GAAGTCAACGTTGTGGGCAC

Product: CheA signal transduction histidine kinase

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 777; Mature: 777

Protein sequence:

>777_residues
MFIEDDELRGLYKAASAEHIETIEAGLLHLEKNPEDQQQLQALLRATHSLKGDSRMLGVGDAETVTHQMEDLLSEVEQGD
RILSSGLCDLLYSGLDAVRKIAHTAVTGEQTDVSVFHVMAQLMAGDDADIPSGPAATLDIIQGDETVEIDPAATLIQVAE
ETEPDLAAELNQLLKQSPSDQGQSKPAETPTTSPYQVDTVRVEAAKLDQLMTQASELAVTKLRIAQRLGEVEQLATLREQ
WTTDLQAQQLSLTPLKQQLSAADAMLVDQVLQVHQQRLSALSFQIENLKAQVGEDSTRLDITANQLEVGIRNLRMLPVAG
LFQLFPRMVRDLAKQQQKQIELVLEGTDTLADKNILEQMQAPLTHLVRNAIDHGIETTAERMAMGKSETATLRLRAYQLG
SSIAIELTDDGRGLELTKIQETAIRRGLHTETELARMTTSQVQSLIFAPGFSTRTQVTEISGRGVGLDVVRANVERLQGT
IQVRSIPSQGCTFQLTLSSSLTTTAVLIVEVNQHPYAIPLEYVDKMISVTPDQIFSLEGHPTITDQDQPLSVMWLSDVLE
LPTEQDRHETERTNIPCVILQIGSERLGLFIDQLVDQQDIVLKPQSKLLKRIRNITGATILGNGEICMVLNPQDFLQATQ
GMDDLTLSEHLHEAVTSKVLLVEDSIPIRTQMKRILQGAGYDVTAAVDGQEGLEKLQADRFDAVVSDVEMPNLTGLEMTA
QIRQRQEYQQLPIVLVTTLAKEEDKRRGQEAGANAYLTKGDFDQTLLIETLRRLIAS

Sequences:

>Translated_777_residues
MFIEDDELRGLYKAASAEHIETIEAGLLHLEKNPEDQQQLQALLRATHSLKGDSRMLGVGDAETVTHQMEDLLSEVEQGD
RILSSGLCDLLYSGLDAVRKIAHTAVTGEQTDVSVFHVMAQLMAGDDADIPSGPAATLDIIQGDETVEIDPAATLIQVAE
ETEPDLAAELNQLLKQSPSDQGQSKPAETPTTSPYQVDTVRVEAAKLDQLMTQASELAVTKLRIAQRLGEVEQLATLREQ
WTTDLQAQQLSLTPLKQQLSAADAMLVDQVLQVHQQRLSALSFQIENLKAQVGEDSTRLDITANQLEVGIRNLRMLPVAG
LFQLFPRMVRDLAKQQQKQIELVLEGTDTLADKNILEQMQAPLTHLVRNAIDHGIETTAERMAMGKSETATLRLRAYQLG
SSIAIELTDDGRGLELTKIQETAIRRGLHTETELARMTTSQVQSLIFAPGFSTRTQVTEISGRGVGLDVVRANVERLQGT
IQVRSIPSQGCTFQLTLSSSLTTTAVLIVEVNQHPYAIPLEYVDKMISVTPDQIFSLEGHPTITDQDQPLSVMWLSDVLE
LPTEQDRHETERTNIPCVILQIGSERLGLFIDQLVDQQDIVLKPQSKLLKRIRNITGATILGNGEICMVLNPQDFLQATQ
GMDDLTLSEHLHEAVTSKVLLVEDSIPIRTQMKRILQGAGYDVTAAVDGQEGLEKLQADRFDAVVSDVEMPNLTGLEMTA
QIRQRQEYQQLPIVLVTTLAKEEDKRRGQEAGANAYLTKGDFDQTLLIETLRRLIAS
>Mature_777_residues
MFIEDDELRGLYKAASAEHIETIEAGLLHLEKNPEDQQQLQALLRATHSLKGDSRMLGVGDAETVTHQMEDLLSEVEQGD
RILSSGLCDLLYSGLDAVRKIAHTAVTGEQTDVSVFHVMAQLMAGDDADIPSGPAATLDIIQGDETVEIDPAATLIQVAE
ETEPDLAAELNQLLKQSPSDQGQSKPAETPTTSPYQVDTVRVEAAKLDQLMTQASELAVTKLRIAQRLGEVEQLATLREQ
WTTDLQAQQLSLTPLKQQLSAADAMLVDQVLQVHQQRLSALSFQIENLKAQVGEDSTRLDITANQLEVGIRNLRMLPVAG
LFQLFPRMVRDLAKQQQKQIELVLEGTDTLADKNILEQMQAPLTHLVRNAIDHGIETTAERMAMGKSETATLRLRAYQLG
SSIAIELTDDGRGLELTKIQETAIRRGLHTETELARMTTSQVQSLIFAPGFSTRTQVTEISGRGVGLDVVRANVERLQGT
IQVRSIPSQGCTFQLTLSSSLTTTAVLIVEVNQHPYAIPLEYVDKMISVTPDQIFSLEGHPTITDQDQPLSVMWLSDVLE
LPTEQDRHETERTNIPCVILQIGSERLGLFIDQLVDQQDIVLKPQSKLLKRIRNITGATILGNGEICMVLNPQDFLQATQ
GMDDLTLSEHLHEAVTSKVLLVEDSIPIRTQMKRILQGAGYDVTAAVDGQEGLEKLQADRFDAVVSDVEMPNLTGLEMTA
QIRQRQEYQQLPIVLVTTLAKEEDKRRGQEAGANAYLTKGDFDQTLLIETLRRLIAS

Specific function: FrzE is involved in a sensory transduction pathway that controls the frequency at which cells reverse their gliding direction. FrzE seems to be capable of autophosphorylating itself on an histidine residue and then to transfer that group to an aspartate r

COG id: COG0643

COG function: function code NT; Chemotaxis protein histidine kinase and related kinases

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 response regulatory domain [H]

Homologues:

Organism=Escherichia coli, GI1788197, Length=639, Percent_Identity=29.7339593114241, Blast_Score=231, Evalue=1e-61,
Organism=Escherichia coli, GI1788191, Length=118, Percent_Identity=36.4406779661017, Blast_Score=69, Evalue=2e-12,
Organism=Escherichia coli, GI1788713, Length=101, Percent_Identity=34.6534653465347, Blast_Score=64, Evalue=5e-11,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR003594
- InterPro:   IPR002545
- InterPro:   IPR011006
- InterPro:   IPR004358
- InterPro:   IPR008207
- InterPro:   IPR005467
- InterPro:   IPR001789 [H]

Pfam domain/function: PF01584 CheW; PF02518 HATPase_c; PF01627 Hpt; PF00072 Response_reg [H]

EC number: =2.7.13.3 [H]

Molecular weight: Translated: 85742; Mature: 85742

Theoretical pI: Translated: 4.42; Mature: 4.42

Prosite motif: PS50851 CHEW ; PS50894 HPT ; PS50110 RESPONSE_REGULATORY ; PS50109 HIS_KIN

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.5 %Cys     (Translated Protein)
2.6 %Met     (Translated Protein)
3.1 %Cys+Met (Translated Protein)
0.5 %Cys     (Mature Protein)
2.6 %Met     (Mature Protein)
3.1 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MFIEDDELRGLYKAASAEHIETIEAGLLHLEKNPEDQQQLQALLRATHSLKGDSRMLGVG
CCCCCHHHHHHHHHHCHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHCCCCCCEEEECC
DAETVTHQMEDLLSEVEQGDRILSSGLCDLLYSGLDAVRKIAHTAVTGEQTDVSVFHVMA
CHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHH
QLMAGDDADIPSGPAATLDIIQGDETVEIDPAATLIQVAEETEPDLAAELNQLLKQSPSD
HHHCCCCCCCCCCCCCEEEEECCCCEEEECCHHHHHHHHHCCCCHHHHHHHHHHHCCCCC
QGQSKPAETPTTSPYQVDTVRVEAAKLDQLMTQASELAVTKLRIAQRLGEVEQLATLREQ
CCCCCCCCCCCCCCEEEEEEEEHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
WTTDLQAQQLSLTPLKQQLSAADAMLVDQVLQVHQQRLSALSFQIENLKAQVGEDSTRLD
HCCCHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCEEE
ITANQLEVGIRNLRMLPVAGLFQLFPRMVRDLAKQQQKQIELVLEGTDTLADKNILEQMQ
EEHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHEEEEEECCHHHHHHHHHHHHH
APLTHLVRNAIDHGIETTAERMAMGKSETATLRLRAYQLGSSIAIELTDDGRGLELTKIQ
HHHHHHHHHHHHCCHHHHHHHHHCCCCCCEEEEEEEEECCCEEEEEECCCCCCCEEHHHH
ETAIRRGLHTETELARMTTSQVQSLIFAPGFSTRTQVTEISGRGVGLDVVRANVERLQGT
HHHHHCCCCCHHHHHHHHHHHHHHHHCCCCCCCCCEEEEECCCCCCHHHHHHHHHHHHCE
IQVRSIPSQGCTFQLTLSSSLTTTAVLIVEVNQHPYAIPLEYVDKMISVTPDQIFSLEGH
EEEEECCCCCCEEEEEECCCCCEEEEEEEEECCCCCEECHHHHHHHHHCCCHHHEECCCC
PTITDQDQPLSVMWLSDVLELPTEQDRHETERTNIPCVILQIGSERLGLFIDQLVDQQDI
CCCCCCCCCEEHHHHHHHHHCCCCCHHHHHHCCCCCEEEEEECCHHHHHHHHHHCCCCCE
VLKPQSKLLKRIRNITGATILGNGEICMVLNPQDFLQATQGMDDLTLSEHLHEAVTSKVL
EECCHHHHHHHHHCCCCCEEECCCCEEEEECCHHHHHHHCCCCCHHHHHHHHHHHHCCEE
LVEDSIPIRTQMKRILQGAGYDVTAAVDGQEGLEKLQADRFDAVVSDVEMPNLTGLEMTA
EEECCCCHHHHHHHHHCCCCCEEEEEECCHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHH
QIRQRQEYQQLPIVLVTTLAKEEDKRRGQEAGANAYLTKGDFDQTLLIETLRRLIAS
HHHHHHHHHHCCCCEEHHHHHHHHHHHHHHCCCCEEEECCCCCHHHHHHHHHHHHCC
>Mature Secondary Structure
MFIEDDELRGLYKAASAEHIETIEAGLLHLEKNPEDQQQLQALLRATHSLKGDSRMLGVG
CCCCCHHHHHHHHHHCHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHCCCCCCEEEECC
DAETVTHQMEDLLSEVEQGDRILSSGLCDLLYSGLDAVRKIAHTAVTGEQTDVSVFHVMA
CHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHH
QLMAGDDADIPSGPAATLDIIQGDETVEIDPAATLIQVAEETEPDLAAELNQLLKQSPSD
HHHCCCCCCCCCCCCCEEEEECCCCEEEECCHHHHHHHHHCCCCHHHHHHHHHHHCCCCC
QGQSKPAETPTTSPYQVDTVRVEAAKLDQLMTQASELAVTKLRIAQRLGEVEQLATLREQ
CCCCCCCCCCCCCCEEEEEEEEHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
WTTDLQAQQLSLTPLKQQLSAADAMLVDQVLQVHQQRLSALSFQIENLKAQVGEDSTRLD
HCCCHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCEEE
ITANQLEVGIRNLRMLPVAGLFQLFPRMVRDLAKQQQKQIELVLEGTDTLADKNILEQMQ
EEHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHEEEEEECCHHHHHHHHHHHHH
APLTHLVRNAIDHGIETTAERMAMGKSETATLRLRAYQLGSSIAIELTDDGRGLELTKIQ
HHHHHHHHHHHHCCHHHHHHHHHCCCCCCEEEEEEEEECCCEEEEEECCCCCCCEEHHHH
ETAIRRGLHTETELARMTTSQVQSLIFAPGFSTRTQVTEISGRGVGLDVVRANVERLQGT
HHHHHCCCCCHHHHHHHHHHHHHHHHCCCCCCCCCEEEEECCCCCCHHHHHHHHHHHHCE
IQVRSIPSQGCTFQLTLSSSLTTTAVLIVEVNQHPYAIPLEYVDKMISVTPDQIFSLEGH
EEEEECCCCCCEEEEEECCCCCEEEEEEEEECCCCCEECHHHHHHHHHCCCHHHEECCCC
PTITDQDQPLSVMWLSDVLELPTEQDRHETERTNIPCVILQIGSERLGLFIDQLVDQQDI
CCCCCCCCCEEHHHHHHHHHCCCCCHHHHHHCCCCCEEEEEECCHHHHHHHHHHCCCCCE
VLKPQSKLLKRIRNITGATILGNGEICMVLNPQDFLQATQGMDDLTLSEHLHEAVTSKVL
EECCHHHHHHHHHCCCCCEEECCCCEEEEECCHHHHHHHCCCCCHHHHHHHHHHHHCCEE
LVEDSIPIRTQMKRILQGAGYDVTAAVDGQEGLEKLQADRFDAVVSDVEMPNLTGLEMTA
EEECCCCHHHHHHHHHCCCCCEEEEEECCHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHH
QIRQRQEYQQLPIVLVTTLAKEEDKRRGQEAGANAYLTKGDFDQTLLIETLRRLIAS
HHHHHHHHHHCCCCEEHHHHHHHHHHHHHHCCCCEEEECCCCCHHHHHHHHHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 2165608; 2123853 [H]