| Definition | Nocardioides sp. JS614 chromosome, complete genome. |
|---|---|
| Accession | NC_008699 |
| Length | 4,985,871 |
Click here to switch to the map view.
The map label for this gene is int [H]
Identifier: 119715338
GI number: 119715338
Start: 1159085
End: 1160236
Strand: Reverse
Name: int [H]
Synonym: Noca_1100
Alternate gene names: 119715338
Gene position: 1160236-1159085 (Counterclockwise)
Preceding gene: 119715340
Following gene: 119715337
Centisome position: 23.27
GC content: 68.23
Gene sequence:
>1152_bases ATGGCGGGAAACATCGCCAAGCGAGCCAACGGCAAGTGGCGTGCGCGGTACCGCGACGAGGCCGGCAACGAACGCGCCCG GCACTTCGACCGCAAGATCGACGCCCAGCAGTGGCTGGATCAAGTCACCTCGGCGGTAGTCACCGGCACGTACGCCGACC CCAAGGCCGGCCGGATCACGTTCGCGGCCTTCTTCGGCGAGTGGTCGGCCCGCCAGGTCTGGGCACCCGGCACCGTGCTC GCGATGTCACTGGCGGCGAGATCCGTGCCCTTCGCGGGGAAGCCGATGAAGCAGGTCCGGCGCTCGGACGTCGAGACCTG GATCAAGCAGATGAACGCCGCCGGACTCGCCCCCGGCACGATCAAGACGCGCTACGTCAACGTCAGATCAGTGTTCCGAG CCGCCGTGAAGGACCGGGTGATCGGCTCCGACCCGACCGACGGCGTACGCCTTCCCCGCGGCCGTCGCGCGGACGTCGGC ATGTCGATCCCCGCGCCGGAGGAGGTGAGGCAGCTCATGGCCGTGGCTGACGAACGCTTCCAGCCGTTCATCGCCCTCTG CGCCTTCGCCGGGCTGCGGTTGGGTGAGGCCGCCGGGGTCCAGCTCGGCGACGTCGACTTCCTCCGCAGGTCGCTGAAGG TCTCCCGCCAGGTGCAGCGCGTCAATGGTGGGGCGATTGACGTACGGGCACCGAAGTACGGCTCAGAGCGCGTCGTCTAC CTCGCCGACAGTCTCGTCAACGTGCTCGCCGAGCACGTCGGCGCTCACGGCACCACCGGCAAGGCTCGGTGGCTCTTCGC CGGGGAGGGCGACGACCCACCGCACCAGAACACCATCGGCTACTGGTGGCGGAAGACGCTGCGCGACGCCGGCCTGTCCG GCATCAAACTCCACGACCTGCGGCACTTCTACGCCTCCGGGCTCATCGCGGCCGGGTGCGACGTTGTGACCGTCCAACGA TCGCTCGGGCACGCGAAAGCGACTACGACGCTCAACACCTACGCACACCTCTGGCCGACCGCTGAGGACCGCACACGTAA GGCTGCGGAGTCGATCATGGCCGCGTCGCTGGGCAAGCCGGCCGCGATCCTCGCCGAGGTTGGAGGCGAGTACGGGTCAG TGAGCCATGCATCTGATCGCAGATGTACTTGA
Upstream 100 bases:
>100_bases GGCTCACCGAGCAGACCAACCGTCCCCAGAACCACCGCTGACCCTGCCCCACCGTCGGATCTCAGAGAGACGATGGCGCG ATCCTGGAAGGAGCATCACC
Downstream 100 bases:
>100_bases GCGTCGCCTCGTCTATCAGCCGGTAACGGTCACAGCGCTCCACTCTGGCCGCCCAAATCGTCGAGATAGATGGCGGATCG ACCTGCAGCAGCAGCAAGGG
Product: phage integrase family protein
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 383; Mature: 382
Protein sequence:
>383_residues MAGNIAKRANGKWRARYRDEAGNERARHFDRKIDAQQWLDQVTSAVVTGTYADPKAGRITFAAFFGEWSARQVWAPGTVL AMSLAARSVPFAGKPMKQVRRSDVETWIKQMNAAGLAPGTIKTRYVNVRSVFRAAVKDRVIGSDPTDGVRLPRGRRADVG MSIPAPEEVRQLMAVADERFQPFIALCAFAGLRLGEAAGVQLGDVDFLRRSLKVSRQVQRVNGGAIDVRAPKYGSERVVY LADSLVNVLAEHVGAHGTTGKARWLFAGEGDDPPHQNTIGYWWRKTLRDAGLSGIKLHDLRHFYASGLIAAGCDVVTVQR SLGHAKATTTLNTYAHLWPTAEDRTRKAAESIMAASLGKPAAILAEVGGEYGSVSHASDRRCT
Sequences:
>Translated_383_residues MAGNIAKRANGKWRARYRDEAGNERARHFDRKIDAQQWLDQVTSAVVTGTYADPKAGRITFAAFFGEWSARQVWAPGTVL AMSLAARSVPFAGKPMKQVRRSDVETWIKQMNAAGLAPGTIKTRYVNVRSVFRAAVKDRVIGSDPTDGVRLPRGRRADVG MSIPAPEEVRQLMAVADERFQPFIALCAFAGLRLGEAAGVQLGDVDFLRRSLKVSRQVQRVNGGAIDVRAPKYGSERVVY LADSLVNVLAEHVGAHGTTGKARWLFAGEGDDPPHQNTIGYWWRKTLRDAGLSGIKLHDLRHFYASGLIAAGCDVVTVQR SLGHAKATTTLNTYAHLWPTAEDRTRKAAESIMAASLGKPAAILAEVGGEYGSVSHASDRRCT >Mature_382_residues AGNIAKRANGKWRARYRDEAGNERARHFDRKIDAQQWLDQVTSAVVTGTYADPKAGRITFAAFFGEWSARQVWAPGTVLA MSLAARSVPFAGKPMKQVRRSDVETWIKQMNAAGLAPGTIKTRYVNVRSVFRAAVKDRVIGSDPTDGVRLPRGRRADVGM SIPAPEEVRQLMAVADERFQPFIALCAFAGLRLGEAAGVQLGDVDFLRRSLKVSRQVQRVNGGAIDVRAPKYGSERVVYL ADSLVNVLAEHVGAHGTTGKARWLFAGEGDDPPHQNTIGYWWRKTLRDAGLSGIKLHDLRHFYASGLIAAGCDVVTVQRS LGHAKATTTLNTYAHLWPTAEDRTRKAAESIMAASLGKPAAILAEVGGEYGSVSHASDRRCT
Specific function: Putative integrase that is involved in the insertion of the integrative and conjugative element ICEBs1. Required for the excision of ICEBs1 from the donor cell genome and subsequent integration in the recipient cell genome. Appears not to be transferred t
COG id: COG0582
COG function: function code L; Integrase
Gene ontology:
Cell location: Cytoplasmic
Metaboloic importance: Non Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the 'phage' integrase family [H]
Homologues:
None
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR011010 - InterPro: IPR013762 - InterPro: IPR002104 - InterPro: IPR023109 [H]
Pfam domain/function: PF00589 Phage_integrase [H]
EC number: NA
Molecular weight: Translated: 41749; Mature: 41618
Theoretical pI: Translated: 10.61; Mature: 10.61
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.8 %Cys (Translated Protein) 1.8 %Met (Translated Protein) 2.6 %Cys+Met (Translated Protein) 0.8 %Cys (Mature Protein) 1.6 %Met (Mature Protein) 2.4 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MAGNIAKRANGKWRARYRDEAGNERARHFDRKIDAQQWLDQVTSAVVTGTYADPKAGRIT CCCCCCHHCCCCEEEEECCCCCCHHHHHHHHHCCHHHHHHHHHHHHHCCCCCCCCCCEEE FAAFFGEWSARQVWAPGTVLAMSLAARSVPFAGKPMKQVRRSDVETWIKQMNAAGLAPGT EEEECCCCCCCEECCCHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHCCCCCCCCC IKTRYVNVRSVFRAAVKDRVIGSDPTDGVRLPRGRRADVGMSIPAPEEVRQLMAVADERF CEEEEEHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHH QPFIALCAFAGLRLGEAAGVQLGDVDFLRRSLKVSRQVQRVNGGAIDVRAPKYGSERVVY HHHHHHHHHHHCCCCHHCCCEECCHHHHHHHHHHHHHHHHHCCCEEEEECCCCCCCEEEE LADSLVNVLAEHVGAHGTTGKARWLFAGEGDDPPHQNTIGYWWRKTLRDAGLSGIKLHDL HHHHHHHHHHHHHCCCCCCCCEEEEEECCCCCCCCCCCHHHHHHHHHHHCCCCCEEHHHH RHFYASGLIAAGCDVVTVQRSLGHAKATTTLNTYAHLWPTAEDRTRKAAESIMAASLGKP HHHHHCCHHHCCCCCEEEHHHCCCHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHCCCC AAILAEVGGEYGSVSHASDRRCT HHHHHHHCCCCCCCCCCCCCCCC >Mature Secondary Structure AGNIAKRANGKWRARYRDEAGNERARHFDRKIDAQQWLDQVTSAVVTGTYADPKAGRIT CCCCCHHCCCCEEEEECCCCCCHHHHHHHHHCCHHHHHHHHHHHHHCCCCCCCCCCEEE FAAFFGEWSARQVWAPGTVLAMSLAARSVPFAGKPMKQVRRSDVETWIKQMNAAGLAPGT EEEECCCCCCCEECCCHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHCCCCCCCCC IKTRYVNVRSVFRAAVKDRVIGSDPTDGVRLPRGRRADVGMSIPAPEEVRQLMAVADERF CEEEEEHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHH QPFIALCAFAGLRLGEAAGVQLGDVDFLRRSLKVSRQVQRVNGGAIDVRAPKYGSERVVY HHHHHHHHHHHCCCCHHCCCEECCHHHHHHHHHHHHHHHHHCCCEEEEECCCCCCCEEEE LADSLVNVLAEHVGAHGTTGKARWLFAGEGDDPPHQNTIGYWWRKTLRDAGLSGIKLHDL HHHHHHHHHHHHHCCCCCCCCEEEEEECCCCCCCCCCCHHHHHHHHHHHCCCCCEEHHHH RHFYASGLIAAGCDVVTVQRSLGHAKATTTLNTYAHLWPTAEDRTRKAAESIMAASLGKP HHHHHCCHHHCCCCCEEEHHHCCCHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHCCCC AAILAEVGGEYGSVSHASDRRCT HHHHHHHCCCCCCCCCCCCCCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 9384377 [H]