Definition Neisseria meningitidis 053442, complete genome.
Accession NC_010120
Length 2,153,416

Click here to switch to the map view.

The map label for this gene is insH1 [C]

Identifier: 161869225

GI number: 161869225

Start: 238515

End: 239522

Strand: Direct

Name: insH1 [C]

Synonym: NMCC_0229

Alternate gene names: 161869225

Gene position: 238515-239522 (Clockwise)

Preceding gene: 161869219

Following gene: 161869226

Centisome position: 11.08

GC content: 52.18

Gene sequence:

>1008_bases
ATGAGCACCTTCTTCCAGCAAACCGCCCAAGCCATGATTGCCAAACACATCGACCGTTTCCCGCTATTGAAGTTGGACCA
GGTGATTGATTGGCAACCGATCGAACAGTACCTGAACCGTCAAAAAACCCGTTACCTTAGAGACCACCGCGGCCGTCCCG
CCTACCCCCTGCTGTCCATGTTCAAAGCCGTCCTGCTCGGACAATGGCACAGCCTCTCCGATCCCGAACTCGAACACAGC
CTCATCACCCGCATCGATTTCAACCTGTTTTGCCGCTTTGACGAACTGAGCATCCCCGATTACAGTACTTTATGCCGTTA
CCGCAACTGGCTGGCGCAAGACGACACCCTGTCCGAATTGCTGGAACTGATTAACCGCCAACTGACCGAAAAAGGTTTAA
AAATAGAGAAAGCATCCGCCGCCGTCGTTGATGCCACCATTATTCAGACCGCCGGCAGCACACAGCGTCAGGCCATAGAA
GTCGATGAAGAAGGACAAATCAACGGCCAAACCACACCGAGTAAGGACAAAGATGCCCGTTGGACAAAGAAAAACGGTTT
ATACAGACTCGGTTACAAACAACATACCCGTACCGATGAGGAAGGCTATATCAAGAAACTGCACATCACCCCCGCCAATG
CCCATGAGTGCAAACACCTGTTGCCTTTGTTGGAAGGGTTACCCAAAGGTACGACCGTCTATGCCGATAAAGGCTACGAC
AGTGAGGAAAACCGGCAACATCTGGAAGAGCATCAGTTGTTAGACGGTATTATGCGCAAAGCCTGCCGCAACCGTCCGCT
GTCGGAAGTGCAAACCAAACGCAACCGATATTTGTCGAAGACCCGTTATGTGGTCGAACAAAGCTTCGGTACGCTGCACC
GTAAATTCCGCTATGCGCGGGCGGCCTATTTCGGACTGATTAAAGTGAGTGCGCAAAGCCATCTGAAGGCGATGTGTTTG
AACCTGTTGAAAGCCGCCAACAGGCTAAGTGCGCCCGCTGCCGCCTAA

Upstream 100 bases:

>100_bases
AGATTAGGTGTACTTGGAACATTGGAAATGACAAAGTGAGACCTTTGCAAAATTCCCCAAAATCCCCTAAATTCCCACCA
AGACATTTAGGAGATTTCTC

Downstream 100 bases:

>100_bases
AAAGCAGCCCGGATGCCTGATTATCGGGTATCCGGGGATTAAGGGGGTGTTTGGGTAGAATTAGGAGGTGTTATGGGGCG
AAAACAGCCGAAAACCTGTG

Product: IS1106A3 transposase

Products: NA

Alternate protein names: ORF 1 [H]

Number of amino acids: Translated: 335; Mature: 334

Protein sequence:

>335_residues
MSTFFQQTAQAMIAKHIDRFPLLKLDQVIDWQPIEQYLNRQKTRYLRDHRGRPAYPLLSMFKAVLLGQWHSLSDPELEHS
LITRIDFNLFCRFDELSIPDYSTLCRYRNWLAQDDTLSELLELINRQLTEKGLKIEKASAAVVDATIIQTAGSTQRQAIE
VDEEGQINGQTTPSKDKDARWTKKNGLYRLGYKQHTRTDEEGYIKKLHITPANAHECKHLLPLLEGLPKGTTVYADKGYD
SEENRQHLEEHQLLDGIMRKACRNRPLSEVQTKRNRYLSKTRYVVEQSFGTLHRKFRYARAAYFGLIKVSAQSHLKAMCL
NLLKAANRLSAPAAA

Sequences:

>Translated_335_residues
MSTFFQQTAQAMIAKHIDRFPLLKLDQVIDWQPIEQYLNRQKTRYLRDHRGRPAYPLLSMFKAVLLGQWHSLSDPELEHS
LITRIDFNLFCRFDELSIPDYSTLCRYRNWLAQDDTLSELLELINRQLTEKGLKIEKASAAVVDATIIQTAGSTQRQAIE
VDEEGQINGQTTPSKDKDARWTKKNGLYRLGYKQHTRTDEEGYIKKLHITPANAHECKHLLPLLEGLPKGTTVYADKGYD
SEENRQHLEEHQLLDGIMRKACRNRPLSEVQTKRNRYLSKTRYVVEQSFGTLHRKFRYARAAYFGLIKVSAQSHLKAMCL
NLLKAANRLSAPAAA
>Mature_334_residues
STFFQQTAQAMIAKHIDRFPLLKLDQVIDWQPIEQYLNRQKTRYLRDHRGRPAYPLLSMFKAVLLGQWHSLSDPELEHSL
ITRIDFNLFCRFDELSIPDYSTLCRYRNWLAQDDTLSELLELINRQLTEKGLKIEKASAAVVDATIIQTAGSTQRQAIEV
DEEGQINGQTTPSKDKDARWTKKNGLYRLGYKQHTRTDEEGYIKKLHITPANAHECKHLLPLLEGLPKGTTVYADKGYDS
EENRQHLEEHQLLDGIMRKACRNRPLSEVQTKRNRYLSKTRYVVEQSFGTLHRKFRYARAAYFGLIKVSAQSHLKAMCLN
LLKAANRLSAPAAA

Specific function: Involved in the transposition of the insertion sequence [H]

COG id: COG3039

COG function: function code L; Transposase and inactivated derivatives, IS5 family

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Belongs to the transposase 11 family [H]

Homologues:

Organism=Escherichia coli, GI1788303, Length=313, Percent_Identity=28.1150159744409, Blast_Score=108, Evalue=7e-25,
Organism=Escherichia coli, GI1789921, Length=313, Percent_Identity=28.1150159744409, Blast_Score=107, Evalue=8e-25,
Organism=Escherichia coli, GI1789612, Length=313, Percent_Identity=28.1150159744409, Blast_Score=107, Evalue=8e-25,
Organism=Escherichia coli, GI1789355, Length=313, Percent_Identity=28.1150159744409, Blast_Score=107, Evalue=8e-25,
Organism=Escherichia coli, GI1788518, Length=313, Percent_Identity=28.1150159744409, Blast_Score=107, Evalue=8e-25,
Organism=Escherichia coli, GI1788342, Length=313, Percent_Identity=28.1150159744409, Blast_Score=107, Evalue=8e-25,
Organism=Escherichia coli, GI1787592, Length=313, Percent_Identity=28.1150159744409, Blast_Score=107, Evalue=8e-25,
Organism=Escherichia coli, GI1786877, Length=313, Percent_Identity=28.1150159744409, Blast_Score=107, Evalue=8e-25,
Organism=Escherichia coli, GI1786764, Length=313, Percent_Identity=28.1150159744409, Blast_Score=107, Evalue=8e-25,
Organism=Escherichia coli, GI1786453, Length=313, Percent_Identity=28.1150159744409, Blast_Score=107, Evalue=8e-25,
Organism=Escherichia coli, GI1787634, Length=313, Percent_Identity=27.4760383386581, Blast_Score=104, Evalue=7e-24,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR002559 [H]

Pfam domain/function: PF01609 Transposase_11 [H]

EC number: NA

Molecular weight: Translated: 38687; Mature: 38556

Theoretical pI: Translated: 9.66; Mature: 9.66

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.5 %Cys     (Translated Protein)
1.5 %Met     (Translated Protein)
3.0 %Cys+Met (Translated Protein)
1.5 %Cys     (Mature Protein)
1.2 %Met     (Mature Protein)
2.7 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSTFFQQTAQAMIAKHIDRFPLLKLDQVIDWQPIEQYLNRQKTRYLRDHRGRPAYPLLSM
CCHHHHHHHHHHHHHHHHCCCCHHHHHHCCCHHHHHHHHHHHHHHHHHCCCCCCHHHHHH
FKAVLLGQWHSLSDPELEHSLITRIDFNLFCRFDELSIPDYSTLCRYRNWLAQDDTLSEL
HHHHHHHCCCCCCCCHHHHHHHHHHCHHHEEEECCCCCCCHHHHHHHHHHCCCCHHHHHH
LELINRQLTEKGLKIEKASAAVVDATIIQTAGSTQRQAIEVDEEGQINGQTTPSKDKDAR
HHHHHHHHHHHCCCEEHHHHHHHHHHHHHCCCCCHHHEECCCCCCCCCCCCCCCCCCCCC
WTKKNGLYRLGYKQHTRTDEEGYIKKLHITPANAHECKHLLPLLEGLPKGTTVYADKGYD
HHHHCCEEECCCHHHCCCCCCCCEEEEEECCCCHHHHHHHHHHHHCCCCCCEEEECCCCC
SEENRQHLEEHQLLDGIMRKACRNRPLSEVQTKRNRYLSKTRYVVEQSFGTLHRKFRYAR
CHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
AAYFGLIKVSAQSHLKAMCLNLLKAANRLSAPAAA
HHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCC
>Mature Secondary Structure 
STFFQQTAQAMIAKHIDRFPLLKLDQVIDWQPIEQYLNRQKTRYLRDHRGRPAYPLLSM
CHHHHHHHHHHHHHHHHCCCCHHHHHHCCCHHHHHHHHHHHHHHHHHCCCCCCHHHHHH
FKAVLLGQWHSLSDPELEHSLITRIDFNLFCRFDELSIPDYSTLCRYRNWLAQDDTLSEL
HHHHHHHCCCCCCCCHHHHHHHHHHCHHHEEEECCCCCCCHHHHHHHHHHCCCCHHHHHH
LELINRQLTEKGLKIEKASAAVVDATIIQTAGSTQRQAIEVDEEGQINGQTTPSKDKDAR
HHHHHHHHHHHCCCEEHHHHHHHHHHHHHCCCCCHHHEECCCCCCCCCCCCCCCCCCCCC
WTKKNGLYRLGYKQHTRTDEEGYIKKLHITPANAHECKHLLPLLEGLPKGTTVYADKGYD
HHHHCCEEECCCHHHCCCCCCCCEEEEEECCCCHHHHHHHHHHHHCCCCCCEEEECCCCC
SEENRQHLEEHQLLDGIMRKACRNRPLSEVQTKRNRYLSKTRYVVEQSFGTLHRKFRYAR
CHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
AAYFGLIKVSAQSHLKAMCLNLLKAANRLSAPAAA
HHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: 1320728 [H]