Definition Escherichia coli O157:H7 str. EDL933 chromosome, complete genome.
Accession NC_002655
Length 5,528,445

Click here to switch to the map view.

The map label for this gene is yehI

Identifier: 15802598

GI number:

Start: 2949252

End: 2952881

Strand: Direct

Name: yehI

Synonym: Z3287

Alternate gene names: NA

Gene position: NA

Preceding gene: 15802597

Following gene: 15802599

Centisome position: NA

GC content: NA

Gene sequence:

>3630_bases
ATGGACAAGGAATTACCGTGGCTGGCGGATAACGCCCAACTGGAACTGAAATATAAAAAAGGCAAAACGCCGCTCAGTCA
TCGTCGCTGGCCGGGCGAACCAGTGTCCGTTATCACTGGAAGTCTCATCCAGACATTGGGAGATGAATTACTACAACAAG
CAGGCCAGAAGGAAAATATCACCTGGAATTATGATAAATGCTCACTGGAGTGGCAGTCCGCCATCCAGCAGGCAATCAAT
TTGACTGGCGAGCATAAACCGTCAATCCCAGCCCTTACCATGGCGGCTCTGATCTGTATCGCGCAAAATGACAGCCAGCA
GTTACTTGATGAAATCGTGCAACAAGAGGGGCTGGAATATGCGACGGATGTAGTGATATCGCGTCAGTGCATTGCGCGGC
GTTATGAGAGTGACTCACTGGTCGTCACTTTGCAGTATCAGGACGAGGACTATGGCTACGGTTATGGCTCCGCGACCTAT
AACGATTTCGATCTCCGTTTGCGTAAGCATCTGTCGCTGGCAGAGGAAAGTTGCTGGCAGCGTTGTGCCGATAAACTCAT
TGCCGCACTGCCAGGAATACCCAAAATTCGCCGTCCTTTTATTGCGCTGATCCTCCCGGAAAAACCTGAAATAGCCAATG
AACTCGCCAGTCTTGAAAGCTCCCGGTCAAGTCTCCATTCAAAGGAGTGGTTAAAGGTCGTTGCTACTGATAATACGGCG
GTAAAAAAACTCGAACGATACTGGGGCCTGGACGTATTTAGCGATCGCGAAGCCAGCTACATGTCACAAGAAAACCGCTT
CGGCTACGCGGCCTGCGCCTCCCTTTTGCGCGAACAAGGACTGGCAGCCGTTCCGCGCCTGGCAATGTATGCTCATAAAG
AAGATTGCGGCAGTCTGCTGGTACAAATTAACCATCCGCAAGTCATCCGCACCTTGCTGTTAGTTGCTGATAAAAACAAA
CCCAGCCTGCAACGTGTGGCTAAATACAGTAAAAACTTCCCCCATGCGACGCTCGCCGCACTGGCAGAACTGCTGGCGTT
AAAAGAACCACCAGCCCGCCCTGGTTATCCAATCATCGAAGACAAAAAGCTGCCTGCACAGCAAAAAGCTCGAGAAGAAT
ACTGGCGTACGCTGTTACAAACGCTGATGGCATCGCAGCCACAACTGGCAGCAGAAGTGATGTCGTGGTTAAGTACTCAA
GCCAGGGCAGTGCTGAAGAGTTATTTATCGGCACTGCCAAAACCGGTTATTGATGGCACCGATAACAGCAATCTGCCTGA
AATCCTCGTTTCACCACCGTGGCGTAGTAAGAAAAAAATGACAGCTCCACGTCTTGATTTGGCACGGCTCGAATTAACTC
CGCAAGTTTACTGGCAACCAGGCGAACGAGAGAGGCTTGCCGCCACTGAGTCTGCCCGTTATTTCAGCACGGAATCTCTT
GCGCAACGCATGGAACAAAAAAGTGGGCGAGTTGTATTACAGGAACTGGGTTTTGGGGATGATGTATGGCTGTTTTTGAA
TTATATACTCCCTGGAAAACTGGATGCTGCACGCAATTCACTCATTGTTCAGTGGCATTACTACCAGGGGCGGGTTGAAG
AGATCCTGAATGGCTGGAACTCCCCGGAAGCACAATTAGCAGAACAGGCGCTCCGCAGCGGTCACATAGAAGCGTTAATT
AACATATGGGAAAATGACAACTACTCACGTTATCGTCCGGAAAAGAGTGTCTGGAACCTGTATTTATTGGCACAGTTGCC
GCGTGAGATGGCTTTGACTTTCTGGCTGCGTATCAATGAGAAAAAGCATCTGTTCGCGGGAGAGGACTATTTTCTCAGTA
TCCTCGGATTGGATGCGCTACCAGGTCTGCTGTTGGCTTTTTCACATCGTCCAAAAGAAACATTTCCGTTAATTTTAAAT
TTCGGCGCAACAGAACTGGCCCTGCCCGTTGCCCGCGTCTGGCGACGTTTCGCGGCGCAGCGTGATCTGGCTCGCCAGTG
GATTTTACAATGGCCGGAACATACGGCTACTGCACTTATCCCTCTTGTCTTCACCAAATCTAGCGATAAAAGCGAAGCTG
CATTACTTGCCCTGCGTTTACTTTACGAACATGGGCATGGCGAATTGCTACAAACTGTAGCCAATCGTTGGCAGCGTACA
GATGTATGGCCTGCCCTGGAGCATTTACTGAAACAGGGTCCCATGGAAATTTACCCGGCACGCATTCCAAAAGCCCCTGA
TTTCTGGCATCCGCAAATGTGGTCCAGGCCGCGCCTTATCACTAATAATCAACCTGTTACCGATGACGCTCTGGAAATTA
TCGGCGAAATGCTGCGCTTTACCCAGGGGGGACGTTTTTATAGCGGGCTGGAACAACTGAAAACGTTCTGCCAGCCACAA
ACGCTGGCAGCTTTTGCCTGGGATCTCTTCACTGCGTGGCAACAAGCTGGTGCCCCCGCAAAAGACAACTGGGCATTTCT
GGCGTTAAGTCTCTTTGGTGACGAAAGCACGGCACGGGATCTAACAACACAGATCCTCGCCTGGCCACAAGGCAAATCTG
CCCGTGCTGTCAGCGGCCTGAACATCCTTACCCTGATGAATAATGATATGGCGCTGATACAGCTGCATCATATATCGCAA
CGGGCTAAATCCCGCCCCTTACGTGATAACGCGGCGGAATTTCTTCAGGTAGTCGCAGAAAATCGCGGGCTAAGCCAGGA
AGAGCTAGCGGACAGATTAGTCCCAACCCTGGGCCTTGATGATCCGCAGGCGTTGAGTTTTGATTTTGGTCCCCGGCAGT
TTACCGTTCGCTTCGATGAAAACCTCAACCCGGTTATCTTTGATCAGCAAAACGTTCGCCAGAAAAGCGTTCCCCGGTTG
CGCGCCGATGACGATCAACTGAAAGCGCCCGAGGCACTGGCCCGACTAAAAGGGCTAAAAAAAGATGCTACTCAGGTGAG
CAAAAACCTGCTCCCGCGTCTTGAAGCTGCCCTACGTACCACCCGACGCTGGTCGCTGGCAGATTTTCATTCTCTGTTTG
TTAATCATCCCTTTACCCGTCTGGTTACCCAGCGATTAATATGGGGGGTTTATCCGGCAAATGAACCGCGTCGTTTACTC
AACGCCTTTCGTGTGGCCGCAGAGGGGGGGTTCTGCAATGCGCAAGATGAGCCAATTGACCTGCCTGCGGACGCTCTGAT
TGGCATTGCCCACCCGTTAGAAATGACAGCAGAAATGCGCAGTGAATTTGCACAGCTTTTTGCCGATTACGAAATTATGC
CGCCTTTTCGCCAGTTGGCGCGCCGCACGGTGCTGCTCACACCTGATGAGTCAACCAGTAACAGCCTGACTCGCTGGGAA
GGTAAATCCGCTACCGTTGGGCAACTTATGGGAATGCGATACAAAGGCTGGGAGTCAGGTTATGAGGACGCATTTGTCTA
TGACCTGGGTGAGTACCGGCTGGTCCTTAAGTTTTCACCCGGTTTTAACCACTACAATGTTGATAGCAAAGCGTTAATGA
GCTTCCGTTCTCTTCGAGTGTACCGTGACAATAAATCCGTCACTTTTGCCGAACTTGATGTGTTTAATTTGAGTGAGGCG
TTAAGCGCACCTGACGTCATTTTCCATTAA

Upstream 100 bases:

>100_bases
GAGTAATTCAACACAGGAAGCGCAGTTCTCCGTACTCGATGCCATCACCGCCAGCGAGCTAATTAACGATATTGAAGCCC
TGTTTGAATAAGGAAAGAGC

Downstream 100 bases:

>100_bases
AAACACAGCGGGCAGTGATGCAACTGCCCGTTATCAACACGACTTACCAGCGGGGAAAGCGATGATCGTGCAAAAAGAGC
TGGTTGCTATTTACGATTAT

Product: putative regulator

Products: NA

Alternate protein names: NA

Number of amino acids: NA

Protein sequence:

>1209_residues
MDKELPWLADNAQLELKYKKGKTPLSHRRWPGEPVSVITGSLIQTLGDELLQQAGQKENITWNYDKCSLEWQSAIQQAIN
LTGEHKPSIPALTMAALICIAQNDSQQLLDEIVQQEGLEYATDVVISRQCIARRYESDSLVVTLQYQDEDYGYGYGSATY
NDFDLRLRKHLSLAEESCWQRCADKLIAALPGIPKIRRPFIALILPEKPEIANELASLESSRSSLHSKEWLKVVATDNTA
VKKLERYWGLDVFSDREASYMSQENRFGYAACASLLREQGLAAVPRLAMYAHKEDCGSLLVQINHPQVIRTLLLVADKNK
PSLQRVAKYSKNFPHATLAALAELLALKEPPARPGYPIIEDKKLPAQQKAREEYWRTLLQTLMASQPQLAAEVMSWLSTQ
ARAVLKSYLSALPKPVIDGTDNSNLPEILVSPPWRSKKKMTAPRLDLARLELTPQVYWQPGERERLAATESARYFSTESL
AQRMEQKSGRVVLQELGFGDDVWLFLNYILPGKLDAARNSLIVQWHYYQGRVEEILNGWNSPEAQLAEQALRSGHIEALI
NIWENDNYSRYRPEKSVWNLYLLAQLPREMALTFWLRINEKKHLFAGEDYFLSILGLDALPGLLLAFSHRPKETFPLILN
FGATELALPVARVWRRFAAQRDLARQWILQWPEHTATALIPLVFTKSSDKSEAALLALRLLYEHGHGELLQTVANRWQRT
DVWPALEHLLKQGPMEIYPARIPKAPDFWHPQMWSRPRLITNNQPVTDDALEIIGEMLRFTQGGRFYSGLEQLKTFCQPQ
TLAAFAWDLFTAWQQAGAPAKDNWAFLALSLFGDESTARDLTTQILAWPQGKSARAVSGLNILTLMNNDMALIQLHHISQ
RAKSRPLRDNAAEFLQVVAENRGLSQEELADRLVPTLGLDDPQALSFDFGPRQFTVRFDENLNPVIFDQQNVRQKSVPRL
RADDDQLKAPEALARLKGLKKDATQVSKNLLPRLEAALRTTRRWSLADFHSLFVNHPFTRLVTQRLIWGVYPANEPRRLL
NAFRVAAEGGFCNAQDEPIDLPADALIGIAHPLEMTAEMRSEFAQLFADYEIMPPFRQLARRTVLLTPDESTSNSLTRWE
GKSATVGQLMGMRYKGWESGYEDAFVYDLGEYRLVLKFSPGFNHYNVDSKALMSFRSLRVYRDNKSVTFAELDVFNLSEA
LSAPDVIFH

Sequences:
NA

Specific function: NA

COG id: NA

COG function: NA

Gene ontology:

Cell location: NA

Metaboloic importance: NA

Operon status: NA

Operon components: NA

Similarity: NA

Homologues:

NA

Paralogues:

NA

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: NA

Theoretical pI: NA

Prosite motif: NA

Important sites: NA

Signals:

NA

Transmembrane regions:

NA

Cys/Met content:

NA

Secondary structure: NA

PDB accession: NA

Resolution: NA

Structure class: NA

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: NA

TargetDB status: NA

Availability: NA

References: NA