| Definition | Escherichia coli O157:H7 str. EC4115, complete genome. |
|---|---|
| Accession | NC_011353 |
| Length | 5,572,075 |
Click here to switch to the map view.
The map label for this gene is intE [H]
Identifier: 209396519
GI number: 209396519
Start: 1554887
End: 1556029
Strand: Reverse
Name: intE [H]
Synonym: ECH74115_1599
Alternate gene names: 209396519
Gene position: 1556029-1554887 (Counterclockwise)
Preceding gene: 209398869
Following gene: 209397717
Centisome position: 27.93
GC content: 43.39
Gene sequence:
>1143_bases ATGGCTGCTAGCCCCCGATCTCACAAAATCTCTATACCCAATTTATATTGCAAATTAGATAAGCGAACCGGAAAGGTATA TTGGCAATACAAACATCCACTATCCGGTCGTTTTCATAGCTTAGGAACTGATGAGAATGAAGCAAAACAAGTTGCTACTG AAGCAAATACCATTATTGCTGAACAACGTACCCGACAAATATTAAGCGTCAATGAGCGTCTGGAAAGAATGAAAGGCAGG CGCTCAGACATTACGGTGACAGAATGGCTTGATAAATATAATTCTATCCAGGAGGACAGGCTGCAACATAATGAACTAAG ACCCAACTCCTATCGGCAAAAAGGCAAACCCATCCGTCTTTTCCGTGAGCATTGTGGAATGCAACACCTCAAGGATATTA CCGCACTTGATATTGCCGAAATAATTGATGCTGTAAAGGCTGAAGGTCATAACAGGATGGCGCAAGTCGTGAGAATGGTG TTGATCGACGTCTTCAAAGAAGCACAACACGCAGGACATGTTCCGCCAGGATTTAACCCAGCGCAGGCAACAAAACAACC GCGAAATCGAGTAAACCGTCAAAGATTATCACTGCCCGAATGGCAGGCAATATTTGACAGCGTAAGCAGACGGCAGCCCT ATTTAAAATGCGGGATGCTACTTGCTCTTGTCACTGGACAACGTTTAAGCGATATCTGCAATTTGAAATTCTCTGATATC TGGGACGACATGTTGCACATTACTCAGGAAAAAACCGGTTCAAAACTTGCTATTCCGCTTAACCTGAAATGCGATGCTCT GAATATTACCCTTCGTGAAGTTATATCTCAGTGCAGGGATGCTGTTGTTAGTAAATATCTGGTCCATTACCGTCACACTA CCTCTCAAGCAAACAGAGGAGACCAGGTGTCTGCAAATACTCTTACAACGGCTTTTAAAAAGGCCAGGGAAAAATGTGGC ATAAAATGGGAGCAAGGAACTGCGCCCACATTTCATGAGCAGCGATCTCTGTCAGAACGGTTATATCGGGAACAGGGTCT GGATACGCAAAAGTTGTTAGGTCATAAATCCAGAAAAATGACCGACCGATACAATGATGATCGTGGTAAAGACTGGATTA TCGTAGATATCAAAACAGCATAG
Upstream 100 bases:
>100_bases CGCTACTGGATGATTGACCGAAATTCCCGTTTTGTAGGAACGCTTGCAGAACCGCAACTCCCAATAAACGCAAACCCAAA ACTCCAACGGATAATCGCTG
Downstream 100 bases:
>100_bases AAAATAGCCAGTTTTGGGGAAGGGTTTTGGGGAAAGTTTTGGGGAAGATTTTAAATCATCATAAAACAACGGGCGTGTTA TACGCCCGTTTCAATATTTA
Product: intergrase
Products: NA
Alternate protein names: Int(Lambda); Prophage e14 integrase [H]
Number of amino acids: Translated: 380; Mature: 379
Protein sequence:
>380_residues MAASPRSHKISIPNLYCKLDKRTGKVYWQYKHPLSGRFHSLGTDENEAKQVATEANTIIAEQRTRQILSVNERLERMKGR RSDITVTEWLDKYNSIQEDRLQHNELRPNSYRQKGKPIRLFREHCGMQHLKDITALDIAEIIDAVKAEGHNRMAQVVRMV LIDVFKEAQHAGHVPPGFNPAQATKQPRNRVNRQRLSLPEWQAIFDSVSRRQPYLKCGMLLALVTGQRLSDICNLKFSDI WDDMLHITQEKTGSKLAIPLNLKCDALNITLREVISQCRDAVVSKYLVHYRHTTSQANRGDQVSANTLTTAFKKAREKCG IKWEQGTAPTFHEQRSLSERLYREQGLDTQKLLGHKSRKMTDRYNDDRGKDWIIVDIKTA
Sequences:
>Translated_380_residues MAASPRSHKISIPNLYCKLDKRTGKVYWQYKHPLSGRFHSLGTDENEAKQVATEANTIIAEQRTRQILSVNERLERMKGR RSDITVTEWLDKYNSIQEDRLQHNELRPNSYRQKGKPIRLFREHCGMQHLKDITALDIAEIIDAVKAEGHNRMAQVVRMV LIDVFKEAQHAGHVPPGFNPAQATKQPRNRVNRQRLSLPEWQAIFDSVSRRQPYLKCGMLLALVTGQRLSDICNLKFSDI WDDMLHITQEKTGSKLAIPLNLKCDALNITLREVISQCRDAVVSKYLVHYRHTTSQANRGDQVSANTLTTAFKKAREKCG IKWEQGTAPTFHEQRSLSERLYREQGLDTQKLLGHKSRKMTDRYNDDRGKDWIIVDIKTA >Mature_379_residues AASPRSHKISIPNLYCKLDKRTGKVYWQYKHPLSGRFHSLGTDENEAKQVATEANTIIAEQRTRQILSVNERLERMKGRR SDITVTEWLDKYNSIQEDRLQHNELRPNSYRQKGKPIRLFREHCGMQHLKDITALDIAEIIDAVKAEGHNRMAQVVRMVL IDVFKEAQHAGHVPPGFNPAQATKQPRNRVNRQRLSLPEWQAIFDSVSRRQPYLKCGMLLALVTGQRLSDICNLKFSDIW DDMLHITQEKTGSKLAIPLNLKCDALNITLREVISQCRDAVVSKYLVHYRHTTSQANRGDQVSANTLTTAFKKAREKCGI KWEQGTAPTFHEQRSLSERLYREQGLDTQKLLGHKSRKMTDRYNDDRGKDWIIVDIKTA
Specific function: Integrase from the cryptic lambdoic prophage e14. Integrase is necessary for integration of the phage into the host genome by site-specific recombination. In conjunction with excisionase, integrase is also necessary for excision of the prophage from the h
COG id: NA
COG function: NA
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the 'phage' integrase family [H]
Homologues:
Organism=Escherichia coli, GI1787386, Length=372, Percent_Identity=59.9462365591398, Blast_Score=463, Evalue=1e-132,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR016177 - InterPro: IPR011010 - InterPro: IPR013762 - InterPro: IPR002104 - InterPro: IPR015094 - InterPro: IPR023109 - InterPro: IPR013087 [H]
Pfam domain/function: PF09003 Phage_integ_N; PF00589 Phage_integrase [H]
EC number: NA
Molecular weight: Translated: 43863; Mature: 43732
Theoretical pI: Translated: 10.18; Mature: 10.18
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.8 %Cys (Translated Protein) 2.1 %Met (Translated Protein) 3.9 %Cys+Met (Translated Protein) 1.8 %Cys (Mature Protein) 1.8 %Met (Mature Protein) 3.7 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MAASPRSHKISIPNLYCKLDKRTGKVYWQYKHPLSGRFHSLGTDENEAKQVATEANTIIA CCCCCCCCEEECCCEEEEEECCCCEEEEEECCCCCCCCCCCCCCHHHHHHHHHHHHHHHH EQRTRQILSVNERLERMKGRRSDITVTEWLDKYNSIQEDRLQHNELRPNSYRQKGKPIRL HHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHCCHHHHHHHHHCCCCCHHHHCCCHHHH FREHCGMQHLKDITALDIAEIIDAVKAEGHNRMAQVVRMVLIDVFKEAQHAGHVPPGFNP HHHHCCHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCH AQATKQPRNRVNRQRLSLPEWQAIFDSVSRRQPYLKCGMLLALVTGQRLSDICNLKFSDI HHHHHHHHHHHHHHHCCCCHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHCCCHHHH WDDMLHITQEKTGSKLAIPLNLKCDALNITLREVISQCRDAVVSKYLVHYRHTTSQANRG HHHHHHHHHHCCCCEEEEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCC DQVSANTLTTAFKKAREKCGIKWEQGTAPTFHEQRSLSERLYREQGLDTQKLLGHKSRKM CCCCHHHHHHHHHHHHHHCCCEECCCCCCCHHHHHHHHHHHHHHHCCCHHHHHCCHHHHH TDRYNDDRGKDWIIVDIKTA HHHCCCCCCCEEEEEEEECC >Mature Secondary Structure AASPRSHKISIPNLYCKLDKRTGKVYWQYKHPLSGRFHSLGTDENEAKQVATEANTIIA CCCCCCCEEECCCEEEEEECCCCEEEEEECCCCCCCCCCCCCCHHHHHHHHHHHHHHHH EQRTRQILSVNERLERMKGRRSDITVTEWLDKYNSIQEDRLQHNELRPNSYRQKGKPIRL HHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHCCHHHHHHHHHCCCCCHHHHCCCHHHH FREHCGMQHLKDITALDIAEIIDAVKAEGHNRMAQVVRMVLIDVFKEAQHAGHVPPGFNP HHHHCCHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCH AQATKQPRNRVNRQRLSLPEWQAIFDSVSRRQPYLKCGMLLALVTGQRLSDICNLKFSDI HHHHHHHHHHHHHHHCCCCHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHCCCHHHH WDDMLHITQEKTGSKLAIPLNLKCDALNITLREVISQCRDAVVSKYLVHYRHTTSQANRG HHHHHHHHHHCCCCEEEEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCC DQVSANTLTTAFKKAREKCGIKWEQGTAPTFHEQRSLSERLYREQGLDTQKLLGHKSRKM CCCCHHHHHHHHHHHHHHCCCEECCCCCCCHHHHHHHHHHHHHHHCCCHHHHHCCHHHHH TDRYNDDRGKDWIIVDIKTA HHHCCCCCCCEEEEEEEECC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 8905232; 9278503 [H]