Definition Serratia proteamaculans 568 chromosome, complete genome.
Accession NC_009832
Length 5,448,853

Click here to switch to the map view.

The map label for this gene is yhjK [H]

Identifier: 157368401

GI number: 157368401

Start: 168775

End: 170781

Strand: Direct

Name: yhjK [H]

Synonym: Spro_0152

Alternate gene names: 157368401

Gene position: 168775-170781 (Clockwise)

Preceding gene: 157368400

Following gene: 157368402

Centisome position: 3.1

GC content: 56.8

Gene sequence:

>2007_bases
TTGCGGGTCAGGCGTTCATTAACGATTAAACAGATGGCAACGGTTTCCGGCGTAGCGCTGGTGACAATCTGCATCTTTAT
CGTGATCCAGTTATTCCATTTTGTGCAGCAGCGCAGGGATGACTATGCCCAGCAACTGGAAAATATTGCTCATTCCGTAC
GTCAGCCGCTGGCGGAGGCCGTGCTGCGCATGGACGTGCCGGAAACCAAGCGGGTGCTGAATACCCTGCTGCCGGTCGGT
ATTCTGAGCCGGGCGGATATCGTACTGCCGAACGAATTCCAGGCATTACACGCCAATTTTCCGCCAGAACGCCCGGTACC
GACGCTGATTGCTCGCCTGTTCGAGCTGCCAATCCAGATTTCGGTTCCGCTCTATTCGCTGGAGCGCGTGCCGGCCAACC
CGCAGCCATTGGCTTATCTGGTGCTGCAGGCCGATTCGTTCCGCATGTACCAGTTCATTCTCAGCATGTTGTCGACCATG
TTATCGACCTATTTGCTGCTGGCGCTGATCCTGTCGGTCTCCATTAGCTGGTGTATGAACCGGCTGATGGTGCATCCGCT
GCGGGCGATGGCCAAAGAGCTGGAAAATATTTCCCAGGAAGAGGCGCCATACCATCAACTGATGCTGCCGGCGTTACACC
AGGACGACGAACTGGGGTTGTTGGTGCGCAACTACAACCGCAATCAGCAGCGGCTGGCCAAAGCCTATGCCGAAATGAGC
CGCATGAGCACCCATCATCCGGTCACCGAGCTGCCAAATCAGGCGCTGTTCACCGCCCTGCTGGAGCAGCATATTGCTTC
CAGCCTGCGGCCCGAGCGTTTTAACTTGCTGGTGATCAGCATTGAAACCCTGCATGAGGCCTCCGGCGTGCTCAATCCGG
CAATGCGAGAAGTGCTGCTGTTGACGCTGGTGAAGAAGCTGCGTGAGTGCATCGATGAAAACGGCGTGCTGGCGCAGCTA
AGCAAAACCGAGTTTGCCATTTTGGCCAAAGGCGTCGAGCGTCCGTTCCACGCCATGCAACTGGCGCGTCGTATCATGGC
GCAGATTAACGCGCCGCTGAGCCTGCAGGAGATGCCGTTGCGGCCCAGCGCCAGCATCGGTATCGCCCATTATCTTAATC
CGGGGGAAAGCGCGGAGCAGCTACTGCGCAGTGCCACCTCGGCGATGATGTCGGCGCACCGCGAAGGCAAAAATCAGGTG
TTGTTCTTCGAACCCAGCCTGACGGAACGCACTCAAAAGCGTTTGACGCAGGAAAGTGAAATTCTGCATGCCATCGAGCA
GCGCCGTTTCACCCTGTTTTTACAGCCGCAGGTCGATATGCAGTCCAACTCGGTGATCGGCGCCGAGGCCTTGCTGCGCT
GGCAGCAGTACGACGGCAGCTTTACCCTGCCGGCAGACGTTATTCCATTAGCCGAAGAACTGGGCGTGATTGTGCCGCTC
GGCAACTGGGTGCTGGAAGAGGCTTGCCTGATCCTGGCCGATTGGCAGGCCCGTGGCATTACGCTGCCGCTGGCGGTCAA
TGTCTCCCCAATCCAGATGAAGCATGAAGATTTTATTCCACACCTGAAGAGCCTGCTGGCGCAGTATCAGATTGATCCGC
GCAAGCTGTTGCTGGAAATTACCGAAACGGTGCGTATTGACGATCTCGATCGTGCGTTGGCGCTGTTGCGGGAGTTACAC
GATTTGGGGCTTTCCATCGCGCTGGATGACTTCGGCATGGGATATTCCAGCCTTAATTACCTCAACCGATTGAAATGCCT
GCCGATCGATTTGATTAAAATCGACAAGAGCTTTATTCAGGGCCTGCCGACGGACGACGCTATGGTGCGTATTGTCAGTT
CGATTTCCGAGGTGCTGGCGCTGCCGGTGATGGCCGAAGGCGTCGAAAATGCCGAGCAGCGTGACTGGCTGTTGCAGCAG
GGTATTCATAGCGGCCAGGGCTTTTTGTTTGCACGTCCGTTACCGCGCAGTGAGTTTGAAGCCGAGTTCTGCCGGCCTCC
GGCCTGA

Upstream 100 bases:

>100_bases
AAGATAAAAACAGCAGACAATCGAGTATACTCAGACCGGTCCGAGGGATGGGTATTATTCATCCCTTTTTTATTTCAGCC
CGAATTAGCGGAGAGCAGGT

Downstream 100 bases:

>100_bases
TCCCCCTTTTGCCTTTCGCCATGGGTGACAGCCACGTCGCCCAATAATCCCGTCCGAAAATCGCCAGTGTTATCTACCTC
TTTCGCGTTAGTGCAAACAA

Product: putative phosphodiesterase

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 668; Mature: 668

Protein sequence:

>668_residues
MRVRRSLTIKQMATVSGVALVTICIFIVIQLFHFVQQRRDDYAQQLENIAHSVRQPLAEAVLRMDVPETKRVLNTLLPVG
ILSRADIVLPNEFQALHANFPPERPVPTLIARLFELPIQISVPLYSLERVPANPQPLAYLVLQADSFRMYQFILSMLSTM
LSTYLLLALILSVSISWCMNRLMVHPLRAMAKELENISQEEAPYHQLMLPALHQDDELGLLVRNYNRNQQRLAKAYAEMS
RMSTHHPVTELPNQALFTALLEQHIASSLRPERFNLLVISIETLHEASGVLNPAMREVLLLTLVKKLRECIDENGVLAQL
SKTEFAILAKGVERPFHAMQLARRIMAQINAPLSLQEMPLRPSASIGIAHYLNPGESAEQLLRSATSAMMSAHREGKNQV
LFFEPSLTERTQKRLTQESEILHAIEQRRFTLFLQPQVDMQSNSVIGAEALLRWQQYDGSFTLPADVIPLAEELGVIVPL
GNWVLEEACLILADWQARGITLPLAVNVSPIQMKHEDFIPHLKSLLAQYQIDPRKLLLEITETVRIDDLDRALALLRELH
DLGLSIALDDFGMGYSSLNYLNRLKCLPIDLIKIDKSFIQGLPTDDAMVRIVSSISEVLALPVMAEGVENAEQRDWLLQQ
GIHSGQGFLFARPLPRSEFEAEFCRPPA

Sequences:

>Translated_668_residues
MRVRRSLTIKQMATVSGVALVTICIFIVIQLFHFVQQRRDDYAQQLENIAHSVRQPLAEAVLRMDVPETKRVLNTLLPVG
ILSRADIVLPNEFQALHANFPPERPVPTLIARLFELPIQISVPLYSLERVPANPQPLAYLVLQADSFRMYQFILSMLSTM
LSTYLLLALILSVSISWCMNRLMVHPLRAMAKELENISQEEAPYHQLMLPALHQDDELGLLVRNYNRNQQRLAKAYAEMS
RMSTHHPVTELPNQALFTALLEQHIASSLRPERFNLLVISIETLHEASGVLNPAMREVLLLTLVKKLRECIDENGVLAQL
SKTEFAILAKGVERPFHAMQLARRIMAQINAPLSLQEMPLRPSASIGIAHYLNPGESAEQLLRSATSAMMSAHREGKNQV
LFFEPSLTERTQKRLTQESEILHAIEQRRFTLFLQPQVDMQSNSVIGAEALLRWQQYDGSFTLPADVIPLAEELGVIVPL
GNWVLEEACLILADWQARGITLPLAVNVSPIQMKHEDFIPHLKSLLAQYQIDPRKLLLEITETVRIDDLDRALALLRELH
DLGLSIALDDFGMGYSSLNYLNRLKCLPIDLIKIDKSFIQGLPTDDAMVRIVSSISEVLALPVMAEGVENAEQRDWLLQQ
GIHSGQGFLFARPLPRSEFEAEFCRPPA
>Mature_668_residues
MRVRRSLTIKQMATVSGVALVTICIFIVIQLFHFVQQRRDDYAQQLENIAHSVRQPLAEAVLRMDVPETKRVLNTLLPVG
ILSRADIVLPNEFQALHANFPPERPVPTLIARLFELPIQISVPLYSLERVPANPQPLAYLVLQADSFRMYQFILSMLSTM
LSTYLLLALILSVSISWCMNRLMVHPLRAMAKELENISQEEAPYHQLMLPALHQDDELGLLVRNYNRNQQRLAKAYAEMS
RMSTHHPVTELPNQALFTALLEQHIASSLRPERFNLLVISIETLHEASGVLNPAMREVLLLTLVKKLRECIDENGVLAQL
SKTEFAILAKGVERPFHAMQLARRIMAQINAPLSLQEMPLRPSASIGIAHYLNPGESAEQLLRSATSAMMSAHREGKNQV
LFFEPSLTERTQKRLTQESEILHAIEQRRFTLFLQPQVDMQSNSVIGAEALLRWQQYDGSFTLPADVIPLAEELGVIVPL
GNWVLEEACLILADWQARGITLPLAVNVSPIQMKHEDFIPHLKSLLAQYQIDPRKLLLEITETVRIDDLDRALALLRELH
DLGLSIALDDFGMGYSSLNYLNRLKCLPIDLIKIDKSFIQGLPTDDAMVRIVSSISEVLALPVMAEGVENAEQRDWLLQQ
GIHSGQGFLFARPLPRSEFEAEFCRPPA

Specific function: Unknown

COG id: COG2200

COG function: function code T; FOG: EAL domain

Gene ontology:

Cell location: Cell membrane; Multi-pass membrane protein (Potential) [H]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 HAMP domain [H]

Homologues:

Organism=Escherichia coli, GI226510982, Length=663, Percent_Identity=51.8853695324284, Blast_Score=681, Evalue=0.0,
Organism=Escherichia coli, GI1787541, Length=454, Percent_Identity=29.295154185022, Blast_Score=216, Evalue=5e-57,
Organism=Escherichia coli, GI87081921, Length=417, Percent_Identity=30.9352517985612, Blast_Score=203, Evalue=3e-53,
Organism=Escherichia coli, GI87081743, Length=236, Percent_Identity=35.1694915254237, Blast_Score=157, Evalue=2e-39,
Organism=Escherichia coli, GI1790496, Length=251, Percent_Identity=33.8645418326693, Blast_Score=154, Evalue=2e-38,
Organism=Escherichia coli, GI87081980, Length=260, Percent_Identity=33.8461538461538, Blast_Score=130, Evalue=2e-31,
Organism=Escherichia coli, GI1786507, Length=247, Percent_Identity=34.0080971659919, Blast_Score=130, Evalue=3e-31,
Organism=Escherichia coli, GI1788849, Length=312, Percent_Identity=31.0897435897436, Blast_Score=129, Evalue=4e-31,
Organism=Escherichia coli, GI1788502, Length=260, Percent_Identity=33.8461538461538, Blast_Score=126, Evalue=5e-30,
Organism=Escherichia coli, GI87081845, Length=250, Percent_Identity=33.6, Blast_Score=124, Evalue=2e-29,
Organism=Escherichia coli, GI1787055, Length=291, Percent_Identity=28.5223367697594, Blast_Score=117, Evalue=3e-27,
Organism=Escherichia coli, GI87082096, Length=258, Percent_Identity=30.2325581395349, Blast_Score=109, Evalue=6e-25,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR001054
- InterPro:   IPR000160
- InterPro:   IPR001633
- InterPro:   IPR003660 [H]

Pfam domain/function: PF00563 EAL; PF00990 GGDEF; PF00672 HAMP [H]

EC number: NA

Molecular weight: Translated: 75482; Mature: 75482

Theoretical pI: Translated: 6.24; Mature: 6.24

Prosite motif: PS50885 HAMP ; PS50883 EAL ; PS50887 GGDEF

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.9 %Cys     (Translated Protein)
3.4 %Met     (Translated Protein)
4.3 %Cys+Met (Translated Protein)
0.9 %Cys     (Mature Protein)
3.4 %Met     (Mature Protein)
4.3 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MRVRRSLTIKQMATVSGVALVTICIFIVIQLFHFVQQRRDDYAQQLENIAHSVRQPLAEA
CCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
VLRMDVPETKRVLNTLLPVGILSRADIVLPNEFQALHANFPPERPVPTLIARLFELPIQI
HHHCCCCHHHHHHHHHHHHHHHCCCCEECCCCHHHHHCCCCCCCCHHHHHHHHHHCCCEE
SVPLYSLERVPANPQPLAYLVLQADSFRMYQFILSMLSTMLSTYLLLALILSVSISWCMN
ECCHHHHHCCCCCCCCEEEEEEECCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
RLMVHPLRAMAKELENISQEEAPYHQLMLPALHQDDELGLLVRNYNRNQQRLAKAYAEMS
HHHHHHHHHHHHHHHHCCHHCCCHHHHHHHHHCCCCCCEEEEECCCCCHHHHHHHHHHHH
RMSTHHPVTELPNQALFTALLEQHIASSLRPERFNLLVISIETLHEASGVLNPAMREVLL
HHCCCCCHHHCCHHHHHHHHHHHHHHHCCCCCCEEEEEEEHHHHHHHHCCCCHHHHHHHH
LTLVKKLRECIDENGVLAQLSKTEFAILAKGVERPFHAMQLARRIMAQINAPLSLQEMPL
HHHHHHHHHHHCCCCCEEEHHHHHHHHHHHHHCCHHHHHHHHHHHHHHCCCCCCHHCCCC
RPSASIGIAHYLNPGESAEQLLRSATSAMMSAHREGKNQVLFFEPSLTERTQKRLTQESE
CCCCCCCHHCCCCCCHHHHHHHHHHHHHHHHHHHCCCCCEEEECCCHHHHHHHHHHHHHH
ILHAIEQRRFTLFLQPQVDMQSNSVIGAEALLRWQQYDGSFTLPADVIPLAEELGVIVPL
HHHHHHHCCEEEEECCCCCCCCCCCHHHHHHHHHHHCCCCCCCCHHHHHHHHHCCEEEEC
GNWVLEEACLILADWQARGITLPLAVNVSPIQMKHEDFIPHLKSLLAQYQIDPRKLLLEI
CHHHHHHHHHEEECCCCCCEEEEEEECCCCHHCCHHHHHHHHHHHHHHHCCCHHHHHHHH
TETVRIDDLDRALALLRELHDLGLSIALDDFGMGYSSLNYLNRLKCLPIDLIKIDKSFIQ
HHHHCCCHHHHHHHHHHHHHHCCCEEEECCCCCCHHHHHHHHHHHCCCHHHHHHHHHHHC
GLPTDDAMVRIVSSISEVLALPVMAEGVENAEQRDWLLQQGIHSGQGFLFARPLPRSEFE
CCCCHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHCCCCCCCEEEECCCCCCCCC
AEFCRPPA
HHHCCCCC
>Mature Secondary Structure
MRVRRSLTIKQMATVSGVALVTICIFIVIQLFHFVQQRRDDYAQQLENIAHSVRQPLAEA
CCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
VLRMDVPETKRVLNTLLPVGILSRADIVLPNEFQALHANFPPERPVPTLIARLFELPIQI
HHHCCCCHHHHHHHHHHHHHHHCCCCEECCCCHHHHHCCCCCCCCHHHHHHHHHHCCCEE
SVPLYSLERVPANPQPLAYLVLQADSFRMYQFILSMLSTMLSTYLLLALILSVSISWCMN
ECCHHHHHCCCCCCCCEEEEEEECCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
RLMVHPLRAMAKELENISQEEAPYHQLMLPALHQDDELGLLVRNYNRNQQRLAKAYAEMS
HHHHHHHHHHHHHHHHCCHHCCCHHHHHHHHHCCCCCCEEEEECCCCCHHHHHHHHHHHH
RMSTHHPVTELPNQALFTALLEQHIASSLRPERFNLLVISIETLHEASGVLNPAMREVLL
HHCCCCCHHHCCHHHHHHHHHHHHHHHCCCCCCEEEEEEEHHHHHHHHCCCCHHHHHHHH
LTLVKKLRECIDENGVLAQLSKTEFAILAKGVERPFHAMQLARRIMAQINAPLSLQEMPL
HHHHHHHHHHHCCCCCEEEHHHHHHHHHHHHHCCHHHHHHHHHHHHHHCCCCCCHHCCCC
RPSASIGIAHYLNPGESAEQLLRSATSAMMSAHREGKNQVLFFEPSLTERTQKRLTQESE
CCCCCCCHHCCCCCCHHHHHHHHHHHHHHHHHHHCCCCCEEEECCCHHHHHHHHHHHHHH
ILHAIEQRRFTLFLQPQVDMQSNSVIGAEALLRWQQYDGSFTLPADVIPLAEELGVIVPL
HHHHHHHCCEEEEECCCCCCCCCCCHHHHHHHHHHHCCCCCCCCHHHHHHHHHCCEEEEC
GNWVLEEACLILADWQARGITLPLAVNVSPIQMKHEDFIPHLKSLLAQYQIDPRKLLLEI
CHHHHHHHHHEEECCCCCCEEEEEEECCCCHHCCHHHHHHHHHHHHHHHCCCHHHHHHHH
TETVRIDDLDRALALLRELHDLGLSIALDDFGMGYSSLNYLNRLKCLPIDLIKIDKSFIQ
HHHHCCCHHHHHHHHHHHHHHCCCEEEECCCCCCHHHHHHHHHHHCCCHHHHHHHHHHHC
GLPTDDAMVRIVSSISEVLALPVMAEGVENAEQRDWLLQQGIHSGQGFLFARPLPRSEFE
CCCCHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHCCCCCCCEEEECCCCCCCCC
AEFCRPPA
HHHCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 8041620; 9278503; 10493123 [H]