Definition Azoarcus sp. BH72 chromosome, complete genome.
Accession NC_008702
Length 4,376,040

Click here to switch to the map view.

The map label for this gene is ykoW [H]

Identifier: 119899954

GI number: 119899954

Start: 4024848

End: 4027106

Strand: Direct

Name: ykoW [H]

Synonym: azo3665

Alternate gene names: 119899954

Gene position: 4024848-4027106 (Clockwise)

Preceding gene: 119899953

Following gene: 119899955

Centisome position: 91.97

GC content: 70.3

Gene sequence:

>2259_bases
ATGATCCAGCCTGCGGGTTCGCCCTCCCCCGTCGACGACGACGATCACTTCGCCTTCGCCGCGGAAGAACCGCCGACAGA
CGCGCACCCGGCCTCCCGCCGGCAGGTGTTTCGCGTGCTCTCCGTCGATGACGACGCGGCCTTCCAGCATTCCCTGCGCT
ACGCGCTGGCGAGCTTCCGCTATCGCGACCAGCCGATCGAATTCCTCACTGCCGGCTCCGCCAACGAAGCCGCTTCGCTG
CTCGCGGCGCGGCACGACATCGCCGTGGTGCTGCTCGACGTCGTGATGGAGTCGGACGACGCCGGCCTGCGCCTGGTGAC
CAGCATCCGCGAGCTGCTCGGGAACGCGGAAATCCGCATCATCCTGCTGACCGGCCAGCCCGGCGTCGCGCCGATGCAGA
CCTCGCTGACCCGGCTCGACATCAACGACTACTGGCTCAAGACCGACCTCACCCGCGAGCGCCTGCACGGCATCCTGACC
GGCGCGCTGCGGGCGTGGGAGCAGATCGACGCGCTCAACCGCGCCCGCCGCGGCCTGCAGATGATCGTGGAAGCCAGCAA
CAGCCTGACCTCCTCGCGCACGCTGCACGACTTCTCCGGGCGCGTGGTGAAGGAGCTGGCGCGCCTGCTGCGGCTGGCGC
CGGAAGGGCTGGTGTGCGTGCAGGACGGCCCCGGCAGCGACCCGCAGAGCGCCACCATCGTCGGCGCCGCGGGGCGCTTT
TCCCACCTCGTCGCGGGCCAGCTGTCGGTGCTCGACGACACCCGCATCCGCGAGCTGCTGCGCCAGGCGCTTGCCGAACA
GCAGTCGCTGGCCGATGCCGAAAGCCAGGTGCTGTACTTCCCCGGCAGCGGCGACGGCCCGCGCGCCGCCACCTATGTCG
CCACCCTGCGCGCGCTCGACGACACCGAACTCGAGCTGTTGCGGGTCTTTGCCAGCAACATCAACTCGGGACTGATCAAC
GTCTCCCTGGTCAGCCAGCTGGACCGCATGGCCTACGAGGACAGCCTGCTGGCGATGCCCAACGCCAACGCGCTGCTGCG
CTGCCTCGACAGCGTCCTCGCCCGCCCTGCGCCGCGCGACCGTGCGTTGCTGTTCATCGACCTCGACCAGTACTCCGAAA
GCTGTTTGTCGCTCGGCATCGAGCAGGGCGACCTGCTGCTCGCGCGCATGGCCGCCCGGCTACGCCGCAGCTTTCCGCCG
CCCGCGCTGGTCGCGCGCCTGCACGACGACACCTTCGCCGTCCTCGGTCCGCCGGCGGCCCTCGATCTGGCCCGTCTCGA
CCGCCTGGAAGCCGGGGATGTGGACGACAACGAGCTGGCGCCTTTCATCAGCCTCGGCGCCGCCCGCATCGACCTCGACC
ACTACCAGGGCTCCGCCAAGAGCGCGATGGCCACCGGCAGCCTGCTGCTGAAGCAGAGCCGGCGCCAGGGGCCGGGGCGC
GTCGTGGAGTACGAGCCGGGCATGGAGACGCCACACAACCTGCGCTTCCAGCTCGCCCGCGAACTGCACCACGCGCTGCG
CGGCCGCGAAATCGGGATTGCGCTCCAGGCGCAGTACGACCTCGCCAGCGGCACCGTGGTCGGCGCCGAAGCGCTGGCGC
GATGGACGCGCGCCGACGGCACGCCGATCCCGCCCACCACCTTCATCCCGCTGGCCGAGGCCAACGGCCTCATCGCGCCG
CTGGGCAAGCACATCATCGAACTCACCTGCGAGGCGCTCGCCCGCCTTGCCGCGGCCGGCTTCGGCCACCTGCCGATCGC
GGTCAATGTGTCGGCGCTGCAACTTGCGCAGACCGGCCTGCTGGATGAACTGCGCGCCACGCTGGAAGCGCACGGGCTCG
ATCCGCACATCCTCGAGATCGAGGTCACCGAGTCGATCGCGATGGACGAGCGCTACGCCACCGGCAACATGCTGGGGCGG
CTGTGCGAGGCCGGCTTTCCGATCGCGATCGACGACTTCGGCACCGGCTACTCGTCGCTCGCCTACCTGCGCACGCTGCC
CGCCCACACGCTCAAGATCGACCGCAGCTTCGTGCAGGAAATCGGCGTGACGCCGGAGCGGCAGACGATCGCCGACATGA
TCATCGGCCTCGGCCGCCGGCTCGACATGCGGGTGATCGCGGAGGGCGTAGAGAACAGCGCCCAGGCCGACTGGCTGAAG
ACGCGCGGCTGCCACCACGCGCAAGGCTATCTGTTTGCCCGGCCCGAGCCGGTCGCCGGGCTGATCGCGCGCCTGCAGTC
CGGCCCGGCGCTGCAATGA

Upstream 100 bases:

>100_bases
TGAGTCTCATCTTCTCGATATGAATAGACACTGATATTCCGCGGCGATAATCCCGGCGCCCACGCAGGCCCGTCCGCCGC
CCTCTCGCGGAGGAAGATGG

Downstream 100 bases:

>100_bases
CACGGCTGCTGCAGGCCGCGCGGGCGCTGCGCCCGGTACGGCGGCGCCTGCTGCTGTTCTTCCTGCCCTGGCTGGCGATC
TTCAGCATCGGCGTCCCGCT

Product: putative signaling protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 752; Mature: 752

Protein sequence:

>752_residues
MIQPAGSPSPVDDDDHFAFAAEEPPTDAHPASRRQVFRVLSVDDDAAFQHSLRYALASFRYRDQPIEFLTAGSANEAASL
LAARHDIAVVLLDVVMESDDAGLRLVTSIRELLGNAEIRIILLTGQPGVAPMQTSLTRLDINDYWLKTDLTRERLHGILT
GALRAWEQIDALNRARRGLQMIVEASNSLTSSRTLHDFSGRVVKELARLLRLAPEGLVCVQDGPGSDPQSATIVGAAGRF
SHLVAGQLSVLDDTRIRELLRQALAEQQSLADAESQVLYFPGSGDGPRAATYVATLRALDDTELELLRVFASNINSGLIN
VSLVSQLDRMAYEDSLLAMPNANALLRCLDSVLARPAPRDRALLFIDLDQYSESCLSLGIEQGDLLLARMAARLRRSFPP
PALVARLHDDTFAVLGPPAALDLARLDRLEAGDVDDNELAPFISLGAARIDLDHYQGSAKSAMATGSLLLKQSRRQGPGR
VVEYEPGMETPHNLRFQLARELHHALRGREIGIALQAQYDLASGTVVGAEALARWTRADGTPIPPTTFIPLAEANGLIAP
LGKHIIELTCEALARLAAAGFGHLPIAVNVSALQLAQTGLLDELRATLEAHGLDPHILEIEVTESIAMDERYATGNMLGR
LCEAGFPIAIDDFGTGYSSLAYLRTLPAHTLKIDRSFVQEIGVTPERQTIADMIIGLGRRLDMRVIAEGVENSAQADWLK
TRGCHHAQGYLFARPEPVAGLIARLQSGPALQ

Sequences:

>Translated_752_residues
MIQPAGSPSPVDDDDHFAFAAEEPPTDAHPASRRQVFRVLSVDDDAAFQHSLRYALASFRYRDQPIEFLTAGSANEAASL
LAARHDIAVVLLDVVMESDDAGLRLVTSIRELLGNAEIRIILLTGQPGVAPMQTSLTRLDINDYWLKTDLTRERLHGILT
GALRAWEQIDALNRARRGLQMIVEASNSLTSSRTLHDFSGRVVKELARLLRLAPEGLVCVQDGPGSDPQSATIVGAAGRF
SHLVAGQLSVLDDTRIRELLRQALAEQQSLADAESQVLYFPGSGDGPRAATYVATLRALDDTELELLRVFASNINSGLIN
VSLVSQLDRMAYEDSLLAMPNANALLRCLDSVLARPAPRDRALLFIDLDQYSESCLSLGIEQGDLLLARMAARLRRSFPP
PALVARLHDDTFAVLGPPAALDLARLDRLEAGDVDDNELAPFISLGAARIDLDHYQGSAKSAMATGSLLLKQSRRQGPGR
VVEYEPGMETPHNLRFQLARELHHALRGREIGIALQAQYDLASGTVVGAEALARWTRADGTPIPPTTFIPLAEANGLIAP
LGKHIIELTCEALARLAAAGFGHLPIAVNVSALQLAQTGLLDELRATLEAHGLDPHILEIEVTESIAMDERYATGNMLGR
LCEAGFPIAIDDFGTGYSSLAYLRTLPAHTLKIDRSFVQEIGVTPERQTIADMIIGLGRRLDMRVIAEGVENSAQADWLK
TRGCHHAQGYLFARPEPVAGLIARLQSGPALQ
>Mature_752_residues
MIQPAGSPSPVDDDDHFAFAAEEPPTDAHPASRRQVFRVLSVDDDAAFQHSLRYALASFRYRDQPIEFLTAGSANEAASL
LAARHDIAVVLLDVVMESDDAGLRLVTSIRELLGNAEIRIILLTGQPGVAPMQTSLTRLDINDYWLKTDLTRERLHGILT
GALRAWEQIDALNRARRGLQMIVEASNSLTSSRTLHDFSGRVVKELARLLRLAPEGLVCVQDGPGSDPQSATIVGAAGRF
SHLVAGQLSVLDDTRIRELLRQALAEQQSLADAESQVLYFPGSGDGPRAATYVATLRALDDTELELLRVFASNINSGLIN
VSLVSQLDRMAYEDSLLAMPNANALLRCLDSVLARPAPRDRALLFIDLDQYSESCLSLGIEQGDLLLARMAARLRRSFPP
PALVARLHDDTFAVLGPPAALDLARLDRLEAGDVDDNELAPFISLGAARIDLDHYQGSAKSAMATGSLLLKQSRRQGPGR
VVEYEPGMETPHNLRFQLARELHHALRGREIGIALQAQYDLASGTVVGAEALARWTRADGTPIPPTTFIPLAEANGLIAP
LGKHIIELTCEALARLAAAGFGHLPIAVNVSALQLAQTGLLDELRATLEAHGLDPHILEIEVTESIAMDERYATGNMLGR
LCEAGFPIAIDDFGTGYSSLAYLRTLPAHTLKIDRSFVQEIGVTPERQTIADMIIGLGRRLDMRVIAEGVENSAQADWLK
TRGCHHAQGYLFARPEPVAGLIARLQSGPALQ

Specific function: Probable signaling protein whose physiological role is not yet known [H]

COG id: COG2200

COG function: function code T; FOG: EAL domain

Gene ontology:

Cell location: Cell membrane; Multi-pass membrane protein (Potential) [H]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 PAS (PER-ARNT-SIM) domain [H]

Homologues:

Organism=Escherichia coli, GI226510982, Length=416, Percent_Identity=31.0096153846154, Blast_Score=172, Evalue=9e-44,
Organism=Escherichia coli, GI87081921, Length=426, Percent_Identity=27.9342723004695, Blast_Score=166, Evalue=3e-42,
Organism=Escherichia coli, GI1787541, Length=424, Percent_Identity=29.2452830188679, Blast_Score=158, Evalue=1e-39,
Organism=Escherichia coli, GI87081743, Length=251, Percent_Identity=35.4581673306773, Blast_Score=153, Evalue=5e-38,
Organism=Escherichia coli, GI1790496, Length=251, Percent_Identity=33.4661354581673, Blast_Score=149, Evalue=7e-37,
Organism=Escherichia coli, GI1788502, Length=262, Percent_Identity=34.7328244274809, Blast_Score=143, Evalue=5e-35,
Organism=Escherichia coli, GI87081845, Length=254, Percent_Identity=35.0393700787402, Blast_Score=142, Evalue=8e-35,
Organism=Escherichia coli, GI87081980, Length=245, Percent_Identity=34.6938775510204, Blast_Score=137, Evalue=2e-33,
Organism=Escherichia coli, GI1786507, Length=240, Percent_Identity=32.9166666666667, Blast_Score=131, Evalue=1e-31,
Organism=Escherichia coli, GI1787055, Length=255, Percent_Identity=31.7647058823529, Blast_Score=121, Evalue=2e-28,
Organism=Escherichia coli, GI1788849, Length=212, Percent_Identity=34.4339622641509, Blast_Score=100, Evalue=3e-22,
Organism=Escherichia coli, GI87082096, Length=211, Percent_Identity=32.2274881516588, Blast_Score=94, Evalue=4e-20,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR001054
- InterPro:   IPR000160
- InterPro:   IPR001633
- InterPro:   IPR005330
- InterPro:   IPR000014 [H]

Pfam domain/function: PF00563 EAL; PF00990 GGDEF; PF03707 MHYT [H]

EC number: NA

Molecular weight: Translated: 81518; Mature: 81518

Theoretical pI: Translated: 5.06; Mature: 5.06

Prosite motif: PS50110 RESPONSE_REGULATORY ; PS50883 EAL ; PS50887 GGDEF

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.8 %Cys     (Translated Protein)
1.7 %Met     (Translated Protein)
2.5 %Cys+Met (Translated Protein)
0.8 %Cys     (Mature Protein)
1.7 %Met     (Mature Protein)
2.5 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MIQPAGSPSPVDDDDHFAFAAEEPPTDAHPASRRQVFRVLSVDDDAAFQHSLRYALASFR
CCCCCCCCCCCCCCCCEEEECCCCCCCCCCCHHHHHHHHEECCCHHHHHHHHHHHHHHHH
YRDQPIEFLTAGSANEAASLLAARHDIAVVLLDVVMESDDAGLRLVTSIRELLGNAEIRI
CCCCCCEEEECCCCHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHCCCCEEE
ILLTGQPGVAPMQTSLTRLDINDYWLKTDLTRERLHGILTGALRAWEQIDALNRARRGLQ
EEEECCCCCCCHHHCCEEECCCCEEEECCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
MIVEASNSLTSSRTLHDFSGRVVKELARLLRLAPEGLVCVQDGPGSDPQSATIVGAAGRF
HHHHHHCCCCCCCCHHHHCCHHHHHHHHHHHHCCCCEEEEECCCCCCCCCEEEEECCCHH
SHLVAGQLSVLDDTRIRELLRQALAEQQSLADAESQVLYFPGSGDGPRAATYVATLRALD
HHHHHHHHHHCCHHHHHHHHHHHHHHHHHHCCCCCCEEEECCCCCCCHHHHHHHHHHHCC
DTELELLRVFASNINSGLINVSLVSQLDRMAYEDSLLAMPNANALLRCLDSVLARPAPRD
CHHHHHHHHHHHCCCCCEEEHHHHHHHHHHHHCCCEEECCCHHHHHHHHHHHHCCCCCCC
RALLFIDLDQYSESCLSLGIEQGDLLLARMAARLRRSFPPPALVARLHDDTFAVLGPPAA
CEEEEEEHHHHHHHHHHCCCCCCHHHHHHHHHHHHHCCCCHHHHHEECCCCEEEECCCHH
LDLARLDRLEAGDVDDNELAPFISLGAARIDLDHYQGSAKSAMATGSLLLKQSRRQGPGR
HHHHHHHCCCCCCCCCCCCCHHHHHCCCEEEHHHCCCCHHHHHHHHHHHHHHHHCCCCCC
VVEYEPGMETPHNLRFQLARELHHALRGREIGIALQAQYDLASGTVVGAEALARWTRADG
EEEECCCCCCCHHHHHHHHHHHHHHHCCCEEEEEEEEEECCCCCCEECHHHHHHHHCCCC
TPIPPTTFIPLAEANGLIAPLGKHIIELTCEALARLAAAGFGHLPIAVNVSALQLAQTGL
CCCCCCCEEEECCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCEEEEHHHHHHHHHHH
LDELRATLEAHGLDPHILEIEVTESIAMDERYATGNMLGRLCEAGFPIAIDDFGTGYSSL
HHHHHHHHHHCCCCCEEEEEEECCHHHHCCHHHHHHHHHHHHHCCCCEEEECCCCCHHHH
AYLRTLPAHTLKIDRSFVQEIGVTPERQTIADMIIGLGRRLDMRVIAEGVENSAQADWLK
HHHHHCCHHHHHHHHHHHHHHCCCCCHHHHHHHHHHCCCCCHHHHHHHHHCCCHHHHHHH
TRGCHHAQGYLFARPEPVAGLIARLQSGPALQ
HCCCCCCCCEEEECCCCHHHHHHHHCCCCCCC
>Mature Secondary Structure
MIQPAGSPSPVDDDDHFAFAAEEPPTDAHPASRRQVFRVLSVDDDAAFQHSLRYALASFR
CCCCCCCCCCCCCCCCEEEECCCCCCCCCCCHHHHHHHHEECCCHHHHHHHHHHHHHHHH
YRDQPIEFLTAGSANEAASLLAARHDIAVVLLDVVMESDDAGLRLVTSIRELLGNAEIRI
CCCCCCEEEECCCCHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHCCCCEEE
ILLTGQPGVAPMQTSLTRLDINDYWLKTDLTRERLHGILTGALRAWEQIDALNRARRGLQ
EEEECCCCCCCHHHCCEEECCCCEEEECCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
MIVEASNSLTSSRTLHDFSGRVVKELARLLRLAPEGLVCVQDGPGSDPQSATIVGAAGRF
HHHHHHCCCCCCCCHHHHCCHHHHHHHHHHHHCCCCEEEEECCCCCCCCCEEEEECCCHH
SHLVAGQLSVLDDTRIRELLRQALAEQQSLADAESQVLYFPGSGDGPRAATYVATLRALD
HHHHHHHHHHCCHHHHHHHHHHHHHHHHHHCCCCCCEEEECCCCCCCHHHHHHHHHHHCC
DTELELLRVFASNINSGLINVSLVSQLDRMAYEDSLLAMPNANALLRCLDSVLARPAPRD
CHHHHHHHHHHHCCCCCEEEHHHHHHHHHHHHCCCEEECCCHHHHHHHHHHHHCCCCCCC
RALLFIDLDQYSESCLSLGIEQGDLLLARMAARLRRSFPPPALVARLHDDTFAVLGPPAA
CEEEEEEHHHHHHHHHHCCCCCCHHHHHHHHHHHHHCCCCHHHHHEECCCCEEEECCCHH
LDLARLDRLEAGDVDDNELAPFISLGAARIDLDHYQGSAKSAMATGSLLLKQSRRQGPGR
HHHHHHHCCCCCCCCCCCCCHHHHHCCCEEEHHHCCCCHHHHHHHHHHHHHHHHCCCCCC
VVEYEPGMETPHNLRFQLARELHHALRGREIGIALQAQYDLASGTVVGAEALARWTRADG
EEEECCCCCCCHHHHHHHHHHHHHHHCCCEEEEEEEEEECCCCCCEECHHHHHHHHCCCC
TPIPPTTFIPLAEANGLIAPLGKHIIELTCEALARLAAAGFGHLPIAVNVSALQLAQTGL
CCCCCCCEEEECCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCEEEEHHHHHHHHHHH
LDELRATLEAHGLDPHILEIEVTESIAMDERYATGNMLGRLCEAGFPIAIDDFGTGYSSL
HHHHHHHHHHCCCCCEEEEEEECCHHHHCCHHHHHHHHHHHHHCCCCEEEECCCCCHHHH
AYLRTLPAHTLKIDRSFVQEIGVTPERQTIADMIIGLGRRLDMRVIAEGVENSAQADWLK
HHHHHCCHHHHHHHHHHHHHHCCCCCHHHHHHHHHHCCCCCHHHHHHHHHCCCHHHHHHH
TRGCHHAQGYLFARPEPVAGLIARLQSGPALQ
HCCCCCCCCEEEECCCCHHHHHHHHCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 9384377; 11728710 [H]