| Definition | Escherichia coli HS, complete genome. |
|---|---|
| Accession | NC_009800 |
| Length | 4,643,538 |
Click here to switch to the map view.
The map label for this gene is yhjK
Identifier: 157163008
GI number: 157163008
Start: 3724942
End: 3726897
Strand: Reverse
Name: yhjK
Synonym: EcHS_A3732
Alternate gene names: 157163008
Gene position: 3726897-3724942 (Counterclockwise)
Preceding gene: 157163009
Following gene: 157163007
Centisome position: 80.26
GC content: 52.61
Gene sequence:
>1956_bases ATGGCAATGGTGGCAGCCGTTGTCCTGGTGTTCGTTTTTATTTTTTGCACCGTTTTGCTGTTCCATCTGGTCCAGCAGAA TCGCTATAACACGGCTACGCAACTGGAAAGCATTGCTCGCTCTGTCCGCGAACCCTTATCTTCAGCTATTTTGAAAGGCG ATATTCCCGAAGCGGAAGCTATTCTTGCCAGCATTAAACCGGCAGGCGTGGTCAGCCGTGCCGATGTAGTGCTGCCTAAC CAGTTCCAGGCGCTGCGTAAAAGTTTTATTCCAGAGCGCCCGGTGCCGGTAATGGTTACTCGCCTGTTTGAGCTACCGGT TCAAATCTCGCTGGGCGTTTACTCGCTCGAACGTCCGGCAAACCCGCAGCCAATTGCCTATCTGGTACTACAGGCGGATT CCTTCCGTATGTATAAGTTCGTGATGAGCACCCTCTCAACGTTAGTGACCATTTACTTACTTTTGTCGCTTATCCTGACC GTCGCCATCAGCTGGTGCATTAACCGCCTGATTTTGCATCCGTTACGCAATATTGCTCGCGAACTTAACGCCATCCCAGC CAAGGAGCTTGTTGGTCACCAACTGGCATTACCGCGTCTGCATCAGGACGATGAAATCGGTATGTTGGTGCGCAGTTACA ACCTCAACCAGCAATTGCTGCAGCGCCATTATGAAGAACAGAACGAAAATGCGATGCGCTTCCCGGTGTCGGATTTGCCG AACAAAGCCTTGCTGATGGAGATGCTGGAGCAGGTTGTCGCGCGTAAACAAACCACCGCGCTGATGATCATCACCTGTGA AACCCTGCGTGATACTGCGGGCGTGCTGAAAGAGGCGCAACGAGAAATTCTGCTGCTGACGCTGGTGGAAAAACTCAAAT CGGTACTGTCGCCACGTATGATCCTCGCGCAGATTAGCGGTTATGACTTTGCTGTCATTGCCAACGGTGTACAGGAACCG TGGCACGCAATCACCTTAGGTCAGCAAGTGCTCACTATCATGAGCGAGCGCCTGCCGATTGAACGTATTCAACTCCGTCC GCACTGTAGCATTGGCGTGGCGATGTTCTACGGCGATCTCACCGCCGAACAGCTTTACAGTCGCGCTATTTCTGCGGCAT TTACCGCTCGCCATAAAGGCAAGAATCAGATTCAGTTCTTTGATCCGCAGCAGATGGAAGCCGCCCAGAAGCGGTTGACG GAAGAGAGCGATATCCTTAATGCACTGGAAAATCATCAGTTTGCTATTTGGTTACAGCCACAGGTCGAGATGACCAGCGG TAAACTGGTCAGTGCGGAAGTGTTACTGCGTATCCAGCAACCGGATGGCAGTTGGGACCTGCCGGATGGCTTAATCGATC GCATTGAGTGCTGTGGGCTGATGGTTACCGTCGGTCACTGGGTGCTGGAAGAGTCCTGTCGATTGCTTGCAGCCTGGCAA GAGCGCGGCATTATGCTGCCCTTGTCGGTAAACCTCTCTGCGCTGCAACTGATGCACCCGAATATGGTGGCGGATATGCT GGAACTGTTAACCCGCTATCGCATTCAGCCGGGAACACTGATTCTGGAAGTGACAGAAAGCCGACGTATTGACGACCCTC ATGCTGCGGTGGCAATCCTCCGTCCGCTGCGCAATGCCGGAGTTCGGGTGGCGCTGGATGATTTCGGCATGGGCTACGCA GGGCTGCGTCAGCTGCAGCATATGAAATCGTTGCCAATCGACGTACTGAAAATCGACAAAATGTTTGTTGAAGGCTTGCC GGGAGATAGCAGCATGATTGCTGCAATTATCATGCTGGCGCAGAGCCTGAACTTACAAATGATTGCCGAAGGCGTGGAGA CTGAAGCACAACGCGACTGGCTGGCAAAAGCGGGCGTTGGTATTGCCCAGGGCTTCCTTTTTGCTCGCCCACTCCCTATT GAAATCTTCGAAGAGAGTTACCTGGAAGAAAAGTAG
Upstream 100 bases:
>100_bases CCTCTCTTAATGCCGCTGCGATCGGGTATACTCGGGCGGCAATCTGGGATTTCCGGGGGGAGACAATTTGCGCGTAAGTC GCTCGTTAACAATCAAGCAG
Downstream 100 bases:
>100_bases CTACCCCAAACTGATTACAAAACTTTAAAAAGTGCTGGTTTGTGCGAGCCAGCTCAAACTTTTTAACCTTTTTGTTTCAA TTATGATCCAGGTACATTTC
Product: putative phosphodiesterase
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 651; Mature: 650
Protein sequence:
>651_residues MAMVAAVVLVFVFIFCTVLLFHLVQQNRYNTATQLESIARSVREPLSSAILKGDIPEAEAILASIKPAGVVSRADVVLPN QFQALRKSFIPERPVPVMVTRLFELPVQISLGVYSLERPANPQPIAYLVLQADSFRMYKFVMSTLSTLVTIYLLLSLILT VAISWCINRLILHPLRNIARELNAIPAKELVGHQLALPRLHQDDEIGMLVRSYNLNQQLLQRHYEEQNENAMRFPVSDLP NKALLMEMLEQVVARKQTTALMIITCETLRDTAGVLKEAQREILLLTLVEKLKSVLSPRMILAQISGYDFAVIANGVQEP WHAITLGQQVLTIMSERLPIERIQLRPHCSIGVAMFYGDLTAEQLYSRAISAAFTARHKGKNQIQFFDPQQMEAAQKRLT EESDILNALENHQFAIWLQPQVEMTSGKLVSAEVLLRIQQPDGSWDLPDGLIDRIECCGLMVTVGHWVLEESCRLLAAWQ ERGIMLPLSVNLSALQLMHPNMVADMLELLTRYRIQPGTLILEVTESRRIDDPHAAVAILRPLRNAGVRVALDDFGMGYA GLRQLQHMKSLPIDVLKIDKMFVEGLPGDSSMIAAIIMLAQSLNLQMIAEGVETEAQRDWLAKAGVGIAQGFLFARPLPI EIFEESYLEEK
Sequences:
>Translated_651_residues MAMVAAVVLVFVFIFCTVLLFHLVQQNRYNTATQLESIARSVREPLSSAILKGDIPEAEAILASIKPAGVVSRADVVLPN QFQALRKSFIPERPVPVMVTRLFELPVQISLGVYSLERPANPQPIAYLVLQADSFRMYKFVMSTLSTLVTIYLLLSLILT VAISWCINRLILHPLRNIARELNAIPAKELVGHQLALPRLHQDDEIGMLVRSYNLNQQLLQRHYEEQNENAMRFPVSDLP NKALLMEMLEQVVARKQTTALMIITCETLRDTAGVLKEAQREILLLTLVEKLKSVLSPRMILAQISGYDFAVIANGVQEP WHAITLGQQVLTIMSERLPIERIQLRPHCSIGVAMFYGDLTAEQLYSRAISAAFTARHKGKNQIQFFDPQQMEAAQKRLT EESDILNALENHQFAIWLQPQVEMTSGKLVSAEVLLRIQQPDGSWDLPDGLIDRIECCGLMVTVGHWVLEESCRLLAAWQ ERGIMLPLSVNLSALQLMHPNMVADMLELLTRYRIQPGTLILEVTESRRIDDPHAAVAILRPLRNAGVRVALDDFGMGYA GLRQLQHMKSLPIDVLKIDKMFVEGLPGDSSMIAAIIMLAQSLNLQMIAEGVETEAQRDWLAKAGVGIAQGFLFARPLPI EIFEESYLEEK >Mature_650_residues AMVAAVVLVFVFIFCTVLLFHLVQQNRYNTATQLESIARSVREPLSSAILKGDIPEAEAILASIKPAGVVSRADVVLPNQ FQALRKSFIPERPVPVMVTRLFELPVQISLGVYSLERPANPQPIAYLVLQADSFRMYKFVMSTLSTLVTIYLLLSLILTV AISWCINRLILHPLRNIARELNAIPAKELVGHQLALPRLHQDDEIGMLVRSYNLNQQLLQRHYEEQNENAMRFPVSDLPN KALLMEMLEQVVARKQTTALMIITCETLRDTAGVLKEAQREILLLTLVEKLKSVLSPRMILAQISGYDFAVIANGVQEPW HAITLGQQVLTIMSERLPIERIQLRPHCSIGVAMFYGDLTAEQLYSRAISAAFTARHKGKNQIQFFDPQQMEAAQKRLTE ESDILNALENHQFAIWLQPQVEMTSGKLVSAEVLLRIQQPDGSWDLPDGLIDRIECCGLMVTVGHWVLEESCRLLAAWQE RGIMLPLSVNLSALQLMHPNMVADMLELLTRYRIQPGTLILEVTESRRIDDPHAAVAILRPLRNAGVRVALDDFGMGYAG LRQLQHMKSLPIDVLKIDKMFVEGLPGDSSMIAAIIMLAQSLNLQMIAEGVETEAQRDWLAKAGVGIAQGFLFARPLPIE IFEESYLEEK
Specific function: Unknown
COG id: NA
COG function: NA
Gene ontology:
Cell location: Cell membrane; Multi-pass membrane protein (Potential)
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 1 HAMP domain
Homologues:
Organism=Escherichia coli, GI226510982, Length=651, Percent_Identity=100, Blast_Score=1328, Evalue=0.0, Organism=Escherichia coli, GI1787541, Length=428, Percent_Identity=31.7757009345794, Blast_Score=192, Evalue=5e-50, Organism=Escherichia coli, GI87081921, Length=416, Percent_Identity=31.9711538461538, Blast_Score=188, Evalue=8e-49, Organism=Escherichia coli, GI87081743, Length=237, Percent_Identity=35.4430379746835, Blast_Score=146, Evalue=5e-36, Organism=Escherichia coli, GI1790496, Length=251, Percent_Identity=37.4501992031873, Blast_Score=145, Evalue=7e-36, Organism=Escherichia coli, GI1786507, Length=243, Percent_Identity=33.7448559670782, Blast_Score=124, Evalue=2e-29, Organism=Escherichia coli, GI87081845, Length=250, Percent_Identity=31.2, Blast_Score=119, Evalue=6e-28, Organism=Escherichia coli, GI87081980, Length=262, Percent_Identity=31.6793893129771, Blast_Score=117, Evalue=2e-27, Organism=Escherichia coli, GI1788502, Length=253, Percent_Identity=31.2252964426877, Blast_Score=115, Evalue=1e-26, Organism=Escherichia coli, GI1788849, Length=252, Percent_Identity=28.968253968254, Blast_Score=111, Evalue=2e-25, Organism=Escherichia coli, GI87082096, Length=211, Percent_Identity=33.175355450237, Blast_Score=105, Evalue=8e-24, Organism=Escherichia coli, GI1787055, Length=267, Percent_Identity=26.2172284644195, Blast_Score=92, Evalue=1e-19, Organism=Escherichia coli, GI1787410, Length=153, Percent_Identity=32.6797385620915, Blast_Score=70, Evalue=3e-13,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): YHJK_ECOLI (P37649)
Other databases:
- EMBL: U00039 - EMBL: U00096 - EMBL: AP009048 - PIR: S47750 - RefSeq: AP_004264.1 - RefSeq: NP_417986.4 - ProteinModelPortal: P37649 - DIP: DIP-12384N - IntAct: P37649 - STRING: P37649 - EnsemblBacteria: EBESCT00000004631 - EnsemblBacteria: EBESCT00000015249 - GeneID: 948048 - GenomeReviews: AP009048_GR - GenomeReviews: U00096_GR - KEGG: ecj:JW5943 - KEGG: eco:b3529 - EchoBASE: EB2165 - EcoGene: EG12256 - eggNOG: COG2200 - GeneTree: EBGT00050000008777 - HOGENOM: HBG751764 - ProtClustDB: PRK13561 - BioCyc: EcoCyc:EG12256-MONOMER - Genevestigator: P37649 - InterPro: IPR001054 - InterPro: IPR000160 - InterPro: IPR001633 - InterPro: IPR003660 - SMART: SM00052 - SMART: SM00267 - TIGRFAMs: TIGR00254
Pfam domain/function: PF00563 EAL; PF00990 GGDEF; PF00672 HAMP; SSF55073 A/G_cyclase
EC number: NA
Molecular weight: Translated: 73082; Mature: 72951
Theoretical pI: Translated: 6.08; Mature: 6.08
Prosite motif: PS50883 EAL; PS50887 GGDEF; PS50885 HAMP
Important sites: NA
Signals:
None
Transmembrane regions:
HASH(0x184dea08)-; HASH(0x17ab68ec)-;
Cys/Met content:
1.1 %Cys (Translated Protein) 4.0 %Met (Translated Protein) 5.1 %Cys+Met (Translated Protein) 1.1 %Cys (Mature Protein) 3.8 %Met (Mature Protein) 4.9 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MAMVAAVVLVFVFIFCTVLLFHLVQQNRYNTATQLESIARSVREPLSSAILKGDIPEAEA CHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCHHHH ILASIKPAGVVSRADVVLPNQFQALRKSFIPERPVPVMVTRLFELPVQISLGVYSLERPA HHHHCCCCCCCCCCCEECCHHHHHHHHHCCCCCCHHHHHHHHHHCCCEEEECEEEECCCC NPQPIAYLVLQADSFRMYKFVMSTLSTLVTIYLLLSLILTVAISWCINRLILHPLRNIAR CCCCEEEEEEECCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH ELNAIPAKELVGHQLALPRLHQDDEIGMLVRSYNLNQQLLQRHYEEQNENAMRFPVSDLP HHHCCCHHHHHCCHHCCCCCCCCCCHHHHHHHCCCCHHHHHHHHHHCCCCEEECCHHHCC NKALLMEMLEQVVARKQTTALMIITCETLRDTAGVLKEAQREILLLTLVEKLKSVLSPRM CHHHHHHHHHHHHHHHHCCEEEEEEEHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHH ILAQISGYDFAVIANGVQEPWHAITLGQQVLTIMSERLPIERIQLRPHCSIGVAMFYGDL HHHHHCCCCEEEEECCCCCCHHHHHHHHHHHHHHHHCCCHHHHCCCCCCCEEHHHHHCCH TAEQLYSRAISAAFTARHKGKNQIQFFDPQQMEAAQKRLTEESDILNALENHQFAIWLQP HHHHHHHHHHHHHHHHHHCCCCCEEECCHHHHHHHHHHCCHHHHHHHHHHCCCEEEEECC QVEMTSGKLVSAEVLLRIQQPDGSWDLPDGLIDRIECCGLMVTVGHWVLEESCRLLAAWQ CEEECCCCEEEEEHEEEEECCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH ERGIMLPLSVNLSALQLMHPNMVADMLELLTRYRIQPGTLILEVTESRRIDDPHAAVAIL HCCEEEEEECCHHHHHHHCCHHHHHHHHHHHHHCCCCCCEEEEECCCCCCCCHHHHHHHH RPLRNAGVRVALDDFGMGYAGLRQLQHMKSLPIDVLKIDKMFVEGLPGDSSMIAAIIMLA HHHHHCCCEEEECCCCCCHHHHHHHHHHHHCCHHHHHHHHHHHHCCCCCHHHHHHHHHHH QSLNLQMIAEGVETEAQRDWLAKAGVGIAQGFLFARPLPIEIFEESYLEEK HHCCHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHCCCCCHHHHHHHHCCCH >Mature Secondary Structure AMVAAVVLVFVFIFCTVLLFHLVQQNRYNTATQLESIARSVREPLSSAILKGDIPEAEA HHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCHHHH ILASIKPAGVVSRADVVLPNQFQALRKSFIPERPVPVMVTRLFELPVQISLGVYSLERPA HHHHCCCCCCCCCCCEECCHHHHHHHHHCCCCCCHHHHHHHHHHCCCEEEECEEEECCCC NPQPIAYLVLQADSFRMYKFVMSTLSTLVTIYLLLSLILTVAISWCINRLILHPLRNIAR CCCCEEEEEEECCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH ELNAIPAKELVGHQLALPRLHQDDEIGMLVRSYNLNQQLLQRHYEEQNENAMRFPVSDLP HHHCCCHHHHHCCHHCCCCCCCCCCHHHHHHHCCCCHHHHHHHHHHCCCCEEECCHHHCC NKALLMEMLEQVVARKQTTALMIITCETLRDTAGVLKEAQREILLLTLVEKLKSVLSPRM CHHHHHHHHHHHHHHHHCCEEEEEEEHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHH ILAQISGYDFAVIANGVQEPWHAITLGQQVLTIMSERLPIERIQLRPHCSIGVAMFYGDL HHHHHCCCCEEEEECCCCCCHHHHHHHHHHHHHHHHCCCHHHHCCCCCCCEEHHHHHCCH TAEQLYSRAISAAFTARHKGKNQIQFFDPQQMEAAQKRLTEESDILNALENHQFAIWLQP HHHHHHHHHHHHHHHHHHCCCCCEEECCHHHHHHHHHHCCHHHHHHHHHHCCCEEEEECC QVEMTSGKLVSAEVLLRIQQPDGSWDLPDGLIDRIECCGLMVTVGHWVLEESCRLLAAWQ CEEECCCCEEEEEHEEEEECCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH ERGIMLPLSVNLSALQLMHPNMVADMLELLTRYRIQPGTLILEVTESRRIDDPHAAVAIL HCCEEEEEECCHHHHHHHCCHHHHHHHHHHHHHCCCCCCEEEEECCCCCCCCHHHHHHHH RPLRNAGVRVALDDFGMGYAGLRQLQHMKSLPIDVLKIDKMFVEGLPGDSSMIAAIIMLA HHHHHCCCEEEECCCCCCHHHHHHHHHHHHCCHHHHHHHHHHHHCCCCCHHHHHHHHHHH QSLNLQMIAEGVETEAQRDWLAKAGVGIAQGFLFARPLPIEIFEESYLEEK HHCCHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHCCCCCHHHHHHHHCCCH
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 6.0
TargetDB status: NA
Availability: NA
References: 8041620; 9278503; 10493123