| Definition | Ignicoccus hospitalis KIN4/I chromosome, complete genome. |
|---|---|
| Accession | NC_009776 |
| Length | 1,297,538 |
Click here to switch to the map view.
The map label for this gene is xerD [C]
Identifier: 156937341
GI number: 156937341
Start: 492529
End: 494343
Strand: Reverse
Name: xerD [C]
Synonym: Igni_0548
Alternate gene names: 156937341
Gene position: 494343-492529 (Counterclockwise)
Preceding gene: 156937344
Following gene: 156937340
Centisome position: 38.1
GC content: 56.58
Gene sequence:
>1815_bases ATGAAGGAGCCGCCCCTCAAGCCGTCGCCGGACGAGCCCCTCTCGTCTGCGATAGAGGAATACCTAGAATTCATGGAGGT TTCGGGCGCAAACAAGAAAACCTTGAAGAGCTATAGATCCGCGCTCAAGGACTTCTTGAGCGTGGTGGGCGACAAGAGGG TCGGCGAGGTCAAGTACGAGGACTACGTCAAGTGGGTGAGGAAGAGGATGAAGGAGGGTTTCCCGCGGAGCGTCAAGAAG GACAAGAGGGCACAACAGACTACCTTGCACTACTACAGCTTGTTCGTCAGGAACTTCCTCAAGTGGTTGGGCTTGGAGGG CTTGCCGGCGGTCCCCAAGCCTAGGAAGGACAGCGTAGAGGCCTTGAAGCCCGAAGAGGTGGCGGCGTTGCTCCAAGCGG CCTACGAAGACCCTATAGACTTCCTAATAGTCAGCTTGCTCCTTGAGACAGGCTTACGGGCCTCCGAGGCCCTTAACGTA ACTTTGGACAAGGTGGACTTCCGCCGGAGGCAGATAGCGGTTAGGGGTAAGTACGGCAAGGAGCGCGTGGTGTTCTACGG CCCTCTGACGGAGGAGGCCCTCCGGAGGGCTTGGAGCTATATTGCTCCCTCGGGAAGGCTAGTTCCGCTCAGCTATCAAG CGCTGTACAAGAGGCTCAAGAGGTTAGCTAAGAAGGCGGGCTTGCCGGAGCACAAGCTCCACCCCCACGCGCTGAGGCAC ACCTTCGCCACGGAGGCGCTTAGGAGGGGGATGAGCTTGCCCGCCGTGCAAAGGCTCTTAGGCCACAGCGACATAAAAAC TACTCAAATCTACTTGCACTTGTTAGTGGACGACGTGAGGAACCAGTACTTCCAAGCGTTCTCAGGCGGCCAGCATGGCG TAGACTTGGGAGGCCACTATCACGCCGACTATAGGGGGTATCAGGTTGACGGCGGTGTGTATTATGAACTTGCCGGCGGT CTGCAAGGCGGTGTAGGTCACGACCCAAGCGGTTATGAATACTATAATAGCCAGTATCAGTTTCAAATCCATCACGATCA CCCCCTTAGTGAGAGAGCACGAGTAAGTAAGTTACCACCAGGGCCACCAACATCGATACCGTCGACGAGAGGCCAGACGT CAGCGCGTCAACCGACATATCTATCACAGGGCGCAACAGCTGGAGCACGGCAGCGGTCACCAACATCGCCAGCAGGCCGG CCACCAGCGCTGCCAGCGCTGCCACCACGTTCACCAAGTCCCGCTTCCCGAAGCCCACCTCCGCCCATGCCTTATAAAAA CGAGGGCGTCGGCGCAGTAGGTACTGCGGTTGCTGGCGGCCCTATACTACGTCCTCAAGGGAGACCCCTACAAGGCCTTG AAGGAGGACTTGGAATCCCTGAAGAAGGCGAAGTTGCTTACAGAGGATTTGAGGATTACGGAGAAGGGAATGGAGCTTAT TCAACAACTGATTTCCAAGCCCATATCTTTGAAAGGCAAGGTGGTGAGCGGGGACGGGGAGGGGAGGTACTACCTATCCC TAGAGGGCTACCGGAGGCAAGTGAGGGAGAAGCTGGGCTTCGACCCCTTCCCCGGTACCCTCAACGTGCTGTTGGACCCA ACATCCACGGAGAAGAAGTCTACCCTTATGTTCAAAAGACCGATAATATTGAAGGGATTTACGGAGAACGGGAAGAGGTA TGGGGAGGTCTTGGCGTTCCCGGCGAGGGTCAGTGGGGTGGAGGCGGCTTTGGTTATACCCCTGAAGACCCACCACCCGC CGGAGATAATAGAGTTAATTTCGCCCGTGGAGTTGAGGAAGGCGTTGAAACTTAA
Upstream 100 bases:
>100_bases AACAAGTAGACCGTTAGGAGGGCTAAGAAGAGGGGAAAGGTCTCCACACTCGCTCCCTAATAAACCTTCTCTGAGAGCTA ATACGCGAAGCGGGAACGCA
Downstream 100 bases:
>100_bases GGACGGGGACGAGGTAGAGGTCCTCGTTTACTAGGCCGCTACGAGGCCCGGAAGATGAGTTTTATCAACGCCTTTCTTCC CTCTCAATTCGGTGTCTAAA
Product: phage integrase family protein
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 604; Mature: 604
Protein sequence:
>604_residues MKEPPLKPSPDEPLSSAIEEYLEFMEVSGANKKTLKSYRSALKDFLSVVGDKRVGEVKYEDYVKWVRKRMKEGFPRSVKK DKRAQQTTLHYYSLFVRNFLKWLGLEGLPAVPKPRKDSVEALKPEEVAALLQAAYEDPIDFLIVSLLLETGLRASEALNV TLDKVDFRRRQIAVRGKYGKERVVFYGPLTEEALRRAWSYIAPSGRLVPLSYQALYKRLKRLAKKAGLPEHKLHPHALRH TFATEALRRGMSLPAVQRLLGHSDIKTTQIYLHLLVDDVRNQYFQAFSGGQHGVDLGGHYHADYRGYQVDGGVYYELAGG LQGGVGHDPSGYEYYNSQYQFQIHHDHPLSERARVSKLPPGPPTSIPSTRGQTSARQPTYLSQGATAGARQRSPTSPAGR PPALPALPPRSPSPASRSPPPPMPYKNEGVGAVGTAVAGGPILRPQGRPLQGLEGGLGIPEEGEVAYRGFEDYGEGNGAY STTDFQAHIFERQGGERGRGGEVLPIPRGLPEASEGEAGLRPLPRYPQRAVGPNIHGEEVYPYVQKTDNIEGIYGEREEV WGGLGVPGEGQWGGGGFGYTPEDPPPAGDNRVNFARGVEEGVET
Sequences:
>Translated_604_residues MKEPPLKPSPDEPLSSAIEEYLEFMEVSGANKKTLKSYRSALKDFLSVVGDKRVGEVKYEDYVKWVRKRMKEGFPRSVKK DKRAQQTTLHYYSLFVRNFLKWLGLEGLPAVPKPRKDSVEALKPEEVAALLQAAYEDPIDFLIVSLLLETGLRASEALNV TLDKVDFRRRQIAVRGKYGKERVVFYGPLTEEALRRAWSYIAPSGRLVPLSYQALYKRLKRLAKKAGLPEHKLHPHALRH TFATEALRRGMSLPAVQRLLGHSDIKTTQIYLHLLVDDVRNQYFQAFSGGQHGVDLGGHYHADYRGYQVDGGVYYELAGG LQGGVGHDPSGYEYYNSQYQFQIHHDHPLSERARVSKLPPGPPTSIPSTRGQTSARQPTYLSQGATAGARQRSPTSPAGR PPALPALPPRSPSPASRSPPPPMPYKNEGVGAVGTAVAGGPILRPQGRPLQGLEGGLGIPEEGEVAYRGFEDYGEGNGAY STTDFQAHIFERQGGERGRGGEVLPIPRGLPEASEGEAGLRPLPRYPQRAVGPNIHGEEVYPYVQKTDNIEGIYGEREEV WGGLGVPGEGQWGGGGFGYTPEDPPPAGDNRVNFARGVEEGVET >Mature_604_residues MKEPPLKPSPDEPLSSAIEEYLEFMEVSGANKKTLKSYRSALKDFLSVVGDKRVGEVKYEDYVKWVRKRMKEGFPRSVKK DKRAQQTTLHYYSLFVRNFLKWLGLEGLPAVPKPRKDSVEALKPEEVAALLQAAYEDPIDFLIVSLLLETGLRASEALNV TLDKVDFRRRQIAVRGKYGKERVVFYGPLTEEALRRAWSYIAPSGRLVPLSYQALYKRLKRLAKKAGLPEHKLHPHALRH TFATEALRRGMSLPAVQRLLGHSDIKTTQIYLHLLVDDVRNQYFQAFSGGQHGVDLGGHYHADYRGYQVDGGVYYELAGG LQGGVGHDPSGYEYYNSQYQFQIHHDHPLSERARVSKLPPGPPTSIPSTRGQTSARQPTYLSQGATAGARQRSPTSPAGR PPALPALPPRSPSPASRSPPPPMPYKNEGVGAVGTAVAGGPILRPQGRPLQGLEGGLGIPEEGEVAYRGFEDYGEGNGAY STTDFQAHIFERQGGERGRGGEVLPIPRGLPEASEGEAGLRPLPRYPQRAVGPNIHGEEVYPYVQKTDNIEGIYGEREEV WGGLGVPGEGQWGGGGFGYTPEDPPPAGDNRVNFARGVEEGVET
Specific function: Site-specific tyrosine recombinase, which acts by catalyzing the cutting and rejoining of the recombining DNA molecules [H]
COG id: COG0582
COG function: function code L; Integrase
Gene ontology:
Cell location: Cytoplasm [H]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the 'phage' integrase family. XerC subfamily [H]
Homologues:
Organism=Escherichia coli, GI1789261, Length=184, Percent_Identity=38.0434782608696, Blast_Score=96, Evalue=7e-21, Organism=Escherichia coli, GI1790244, Length=291, Percent_Identity=27.4914089347079, Blast_Score=75, Evalue=1e-14,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR011010 - InterPro: IPR013762 - InterPro: IPR002104 - InterPro: IPR023109 - InterPro: IPR004107 [H]
Pfam domain/function: PF02899 Phage_integr_N; PF00589 Phage_integrase [H]
EC number: NA
Molecular weight: Translated: 66475; Mature: 66475
Theoretical pI: Translated: 9.28; Mature: 9.28
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.0 %Cys (Translated Protein) 0.8 %Met (Translated Protein) 0.8 %Cys+Met (Translated Protein) 0.0 %Cys (Mature Protein) 0.8 %Met (Mature Protein) 0.8 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MKEPPLKPSPDEPLSSAIEEYLEFMEVSGANKKTLKSYRSALKDFLSVVGDKRVGEVKYE CCCCCCCCCCCHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHCCCCCCCCCHH DYVKWVRKRMKEGFPRSVKKDKRAQQTTLHYYSLFVRNFLKWLGLEGLPAVPKPRKDSVE HHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCHH ALKPEEVAALLQAAYEDPIDFLIVSLLLETGLRASEALNVTLDKVDFRRRQIAVRGKYGK HCCHHHHHHHHHHHHHCHHHHHHHHHHHHHCCCHHHHHEEEHHHHHHHHHHEEEECCCCC ERVVFYGPLTEEALRRAWSYIAPSGRLVPLSYQALYKRLKRLAKKAGLPEHKLHPHALRH CEEEEECCCHHHHHHHHHHHHCCCCCEEECCHHHHHHHHHHHHHHCCCCCCCCCHHHHHH TFATEALRRGMSLPAVQRLLGHSDIKTTQIYLHLLVDDVRNQYFQAFSGGQHGVDLGGHY HHHHHHHHCCCCCHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCEE HADYRGYQVDGGVYYELAGGLQGGVGHDPSGYEYYNSQYQFQIHHDHPLSERARVSKLPP ECCCCCEEECCCEEEEECCCCCCCCCCCCCCCCEECCEEEEEEECCCCHHHHHHHCCCCC GPPTSIPSTRGQTSARQPTYLSQGATAGARQRSPTSPAGRPPALPALPPRSPSPASRSPP CCCCCCCCCCCCCCCCCCCHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC PPMPYKNEGVGAVGTAVAGGPILRPQGRPLQGLEGGLGIPEEGEVAYRGFEDYGEGNGAY CCCCCCCCCCCHHHHHHCCCCEECCCCCCCCCCCCCCCCCCCCCEEECCHHHHCCCCCCC STTDFQAHIFERQGGERGRGGEVLPIPRGLPEASEGEAGLRPLPRYPQRAVGPNIHGEEV CCCCHHHHHHHHCCCCCCCCCCEEECCCCCCCCCCCCCCCCCCCCCCHHHCCCCCCCCHH YPYVQKTDNIEGIYGEREEVWGGLGVPGEGQWGGGGFGYTPEDPPPAGDNRVNFARGVEE CCHHHCCCCCCCCCCCHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHH GVET HCCC >Mature Secondary Structure MKEPPLKPSPDEPLSSAIEEYLEFMEVSGANKKTLKSYRSALKDFLSVVGDKRVGEVKYE CCCCCCCCCCCHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHCCCCCCCCCHH DYVKWVRKRMKEGFPRSVKKDKRAQQTTLHYYSLFVRNFLKWLGLEGLPAVPKPRKDSVE HHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCHH ALKPEEVAALLQAAYEDPIDFLIVSLLLETGLRASEALNVTLDKVDFRRRQIAVRGKYGK HCCHHHHHHHHHHHHHCHHHHHHHHHHHHHCCCHHHHHEEEHHHHHHHHHHEEEECCCCC ERVVFYGPLTEEALRRAWSYIAPSGRLVPLSYQALYKRLKRLAKKAGLPEHKLHPHALRH CEEEEECCCHHHHHHHHHHHHCCCCCEEECCHHHHHHHHHHHHHHCCCCCCCCCHHHHHH TFATEALRRGMSLPAVQRLLGHSDIKTTQIYLHLLVDDVRNQYFQAFSGGQHGVDLGGHY HHHHHHHHCCCCCHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCEE HADYRGYQVDGGVYYELAGGLQGGVGHDPSGYEYYNSQYQFQIHHDHPLSERARVSKLPP ECCCCCEEECCCEEEEECCCCCCCCCCCCCCCCEECCEEEEEEECCCCHHHHHHHCCCCC GPPTSIPSTRGQTSARQPTYLSQGATAGARQRSPTSPAGRPPALPALPPRSPSPASRSPP CCCCCCCCCCCCCCCCCCCHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC PPMPYKNEGVGAVGTAVAGGPILRPQGRPLQGLEGGLGIPEEGEVAYRGFEDYGEGNGAY CCCCCCCCCCCHHHHHHCCCCEECCCCCCCCCCCCCCCCCCCCCEEECCHHHHCCCCCCC STTDFQAHIFERQGGERGRGGEVLPIPRGLPEASEGEAGLRPLPRYPQRAVGPNIHGEEV CCCCHHHHHHHHCCCCCCCCCCEEECCCCCCCCCCCCCCCCCCCCCCHHHCCCCCCCCHH YPYVQKTDNIEGIYGEREEVWGGLGVPGEGQWGGGGFGYTPEDPPPAGDNRVNFARGVEE CCHHHCCCCCCCCCCCHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHH GVET HCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: DNA [C]
Specific reaction: Protein + DNA = Protein-DNA [C]
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 9371463 [H]