Definition Nocardioides sp. JS614 chromosome, complete genome.
Accession NC_008699
Length 4,985,871

Click here to switch to the map view.

The map label for this gene is int [H]

Identifier: 119715338

GI number: 119715338

Start: 1159085

End: 1160236

Strand: Reverse

Name: int [H]

Synonym: Noca_1100

Alternate gene names: 119715338

Gene position: 1160236-1159085 (Counterclockwise)

Preceding gene: 119715340

Following gene: 119715337

Centisome position: 23.27

GC content: 68.23

Gene sequence:

>1152_bases
ATGGCGGGAAACATCGCCAAGCGAGCCAACGGCAAGTGGCGTGCGCGGTACCGCGACGAGGCCGGCAACGAACGCGCCCG
GCACTTCGACCGCAAGATCGACGCCCAGCAGTGGCTGGATCAAGTCACCTCGGCGGTAGTCACCGGCACGTACGCCGACC
CCAAGGCCGGCCGGATCACGTTCGCGGCCTTCTTCGGCGAGTGGTCGGCCCGCCAGGTCTGGGCACCCGGCACCGTGCTC
GCGATGTCACTGGCGGCGAGATCCGTGCCCTTCGCGGGGAAGCCGATGAAGCAGGTCCGGCGCTCGGACGTCGAGACCTG
GATCAAGCAGATGAACGCCGCCGGACTCGCCCCCGGCACGATCAAGACGCGCTACGTCAACGTCAGATCAGTGTTCCGAG
CCGCCGTGAAGGACCGGGTGATCGGCTCCGACCCGACCGACGGCGTACGCCTTCCCCGCGGCCGTCGCGCGGACGTCGGC
ATGTCGATCCCCGCGCCGGAGGAGGTGAGGCAGCTCATGGCCGTGGCTGACGAACGCTTCCAGCCGTTCATCGCCCTCTG
CGCCTTCGCCGGGCTGCGGTTGGGTGAGGCCGCCGGGGTCCAGCTCGGCGACGTCGACTTCCTCCGCAGGTCGCTGAAGG
TCTCCCGCCAGGTGCAGCGCGTCAATGGTGGGGCGATTGACGTACGGGCACCGAAGTACGGCTCAGAGCGCGTCGTCTAC
CTCGCCGACAGTCTCGTCAACGTGCTCGCCGAGCACGTCGGCGCTCACGGCACCACCGGCAAGGCTCGGTGGCTCTTCGC
CGGGGAGGGCGACGACCCACCGCACCAGAACACCATCGGCTACTGGTGGCGGAAGACGCTGCGCGACGCCGGCCTGTCCG
GCATCAAACTCCACGACCTGCGGCACTTCTACGCCTCCGGGCTCATCGCGGCCGGGTGCGACGTTGTGACCGTCCAACGA
TCGCTCGGGCACGCGAAAGCGACTACGACGCTCAACACCTACGCACACCTCTGGCCGACCGCTGAGGACCGCACACGTAA
GGCTGCGGAGTCGATCATGGCCGCGTCGCTGGGCAAGCCGGCCGCGATCCTCGCCGAGGTTGGAGGCGAGTACGGGTCAG
TGAGCCATGCATCTGATCGCAGATGTACTTGA

Upstream 100 bases:

>100_bases
GGCTCACCGAGCAGACCAACCGTCCCCAGAACCACCGCTGACCCTGCCCCACCGTCGGATCTCAGAGAGACGATGGCGCG
ATCCTGGAAGGAGCATCACC

Downstream 100 bases:

>100_bases
GCGTCGCCTCGTCTATCAGCCGGTAACGGTCACAGCGCTCCACTCTGGCCGCCCAAATCGTCGAGATAGATGGCGGATCG
ACCTGCAGCAGCAGCAAGGG

Product: phage integrase family protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 383; Mature: 382

Protein sequence:

>383_residues
MAGNIAKRANGKWRARYRDEAGNERARHFDRKIDAQQWLDQVTSAVVTGTYADPKAGRITFAAFFGEWSARQVWAPGTVL
AMSLAARSVPFAGKPMKQVRRSDVETWIKQMNAAGLAPGTIKTRYVNVRSVFRAAVKDRVIGSDPTDGVRLPRGRRADVG
MSIPAPEEVRQLMAVADERFQPFIALCAFAGLRLGEAAGVQLGDVDFLRRSLKVSRQVQRVNGGAIDVRAPKYGSERVVY
LADSLVNVLAEHVGAHGTTGKARWLFAGEGDDPPHQNTIGYWWRKTLRDAGLSGIKLHDLRHFYASGLIAAGCDVVTVQR
SLGHAKATTTLNTYAHLWPTAEDRTRKAAESIMAASLGKPAAILAEVGGEYGSVSHASDRRCT

Sequences:

>Translated_383_residues
MAGNIAKRANGKWRARYRDEAGNERARHFDRKIDAQQWLDQVTSAVVTGTYADPKAGRITFAAFFGEWSARQVWAPGTVL
AMSLAARSVPFAGKPMKQVRRSDVETWIKQMNAAGLAPGTIKTRYVNVRSVFRAAVKDRVIGSDPTDGVRLPRGRRADVG
MSIPAPEEVRQLMAVADERFQPFIALCAFAGLRLGEAAGVQLGDVDFLRRSLKVSRQVQRVNGGAIDVRAPKYGSERVVY
LADSLVNVLAEHVGAHGTTGKARWLFAGEGDDPPHQNTIGYWWRKTLRDAGLSGIKLHDLRHFYASGLIAAGCDVVTVQR
SLGHAKATTTLNTYAHLWPTAEDRTRKAAESIMAASLGKPAAILAEVGGEYGSVSHASDRRCT
>Mature_382_residues
AGNIAKRANGKWRARYRDEAGNERARHFDRKIDAQQWLDQVTSAVVTGTYADPKAGRITFAAFFGEWSARQVWAPGTVLA
MSLAARSVPFAGKPMKQVRRSDVETWIKQMNAAGLAPGTIKTRYVNVRSVFRAAVKDRVIGSDPTDGVRLPRGRRADVGM
SIPAPEEVRQLMAVADERFQPFIALCAFAGLRLGEAAGVQLGDVDFLRRSLKVSRQVQRVNGGAIDVRAPKYGSERVVYL
ADSLVNVLAEHVGAHGTTGKARWLFAGEGDDPPHQNTIGYWWRKTLRDAGLSGIKLHDLRHFYASGLIAAGCDVVTVQRS
LGHAKATTTLNTYAHLWPTAEDRTRKAAESIMAASLGKPAAILAEVGGEYGSVSHASDRRCT

Specific function: Putative integrase that is involved in the insertion of the integrative and conjugative element ICEBs1. Required for the excision of ICEBs1 from the donor cell genome and subsequent integration in the recipient cell genome. Appears not to be transferred t

COG id: COG0582

COG function: function code L; Integrase

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: Non Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the 'phage' integrase family [H]

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR011010
- InterPro:   IPR013762
- InterPro:   IPR002104
- InterPro:   IPR023109 [H]

Pfam domain/function: PF00589 Phage_integrase [H]

EC number: NA

Molecular weight: Translated: 41749; Mature: 41618

Theoretical pI: Translated: 10.61; Mature: 10.61

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.8 %Cys     (Translated Protein)
1.8 %Met     (Translated Protein)
2.6 %Cys+Met (Translated Protein)
0.8 %Cys     (Mature Protein)
1.6 %Met     (Mature Protein)
2.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MAGNIAKRANGKWRARYRDEAGNERARHFDRKIDAQQWLDQVTSAVVTGTYADPKAGRIT
CCCCCCHHCCCCEEEEECCCCCCHHHHHHHHHCCHHHHHHHHHHHHHCCCCCCCCCCEEE
FAAFFGEWSARQVWAPGTVLAMSLAARSVPFAGKPMKQVRRSDVETWIKQMNAAGLAPGT
EEEECCCCCCCEECCCHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHCCCCCCCCC
IKTRYVNVRSVFRAAVKDRVIGSDPTDGVRLPRGRRADVGMSIPAPEEVRQLMAVADERF
CEEEEEHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHH
QPFIALCAFAGLRLGEAAGVQLGDVDFLRRSLKVSRQVQRVNGGAIDVRAPKYGSERVVY
HHHHHHHHHHHCCCCHHCCCEECCHHHHHHHHHHHHHHHHHCCCEEEEECCCCCCCEEEE
LADSLVNVLAEHVGAHGTTGKARWLFAGEGDDPPHQNTIGYWWRKTLRDAGLSGIKLHDL
HHHHHHHHHHHHHCCCCCCCCEEEEEECCCCCCCCCCCHHHHHHHHHHHCCCCCEEHHHH
RHFYASGLIAAGCDVVTVQRSLGHAKATTTLNTYAHLWPTAEDRTRKAAESIMAASLGKP
HHHHHCCHHHCCCCCEEEHHHCCCHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHCCCC
AAILAEVGGEYGSVSHASDRRCT
HHHHHHHCCCCCCCCCCCCCCCC
>Mature Secondary Structure 
AGNIAKRANGKWRARYRDEAGNERARHFDRKIDAQQWLDQVTSAVVTGTYADPKAGRIT
CCCCCHHCCCCEEEEECCCCCCHHHHHHHHHCCHHHHHHHHHHHHHCCCCCCCCCCEEE
FAAFFGEWSARQVWAPGTVLAMSLAARSVPFAGKPMKQVRRSDVETWIKQMNAAGLAPGT
EEEECCCCCCCEECCCHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHCCCCCCCCC
IKTRYVNVRSVFRAAVKDRVIGSDPTDGVRLPRGRRADVGMSIPAPEEVRQLMAVADERF
CEEEEEHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHH
QPFIALCAFAGLRLGEAAGVQLGDVDFLRRSLKVSRQVQRVNGGAIDVRAPKYGSERVVY
HHHHHHHHHHHCCCCHHCCCEECCHHHHHHHHHHHHHHHHHCCCEEEEECCCCCCCEEEE
LADSLVNVLAEHVGAHGTTGKARWLFAGEGDDPPHQNTIGYWWRKTLRDAGLSGIKLHDL
HHHHHHHHHHHHHCCCCCCCCEEEEEECCCCCCCCCCCHHHHHHHHHHHCCCCCEEHHHH
RHFYASGLIAAGCDVVTVQRSLGHAKATTTLNTYAHLWPTAEDRTRKAAESIMAASLGKP
HHHHHCCHHHCCCCCEEEHHHCCCHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHCCCC
AAILAEVGGEYGSVSHASDRRCT
HHHHHHHCCCCCCCCCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 9384377 [H]