Definition Vibrio harveyi ATCC BAA-1116 chromosome II, complete sequence.
Accession NC_009784
Length 2,204,018

Click here to switch to the map view.

The map label for this gene is 156978164

Identifier: 156978164

GI number: 156978164

Start: 2060882

End: 2062345

Strand: Direct

Name: 156978164

Synonym: VIBHAR_06969

Alternate gene names: NA

Gene position: 2060882-2062345 (Clockwise)

Preceding gene: 156978163

Following gene: 156978165

Centisome position: 93.51

GC content: 43.92

Gene sequence:

>1464_bases
ATGAACGGTACTTATATTCTCGAAGCTGGGATGAACATCAGTTGGCACAACCAATCTTACTTAATTCGAGCCCTAGAACC
GGACTTTATTGTTCTAGAGAACAATAAGGGGCAAAAGATGATGCAAAAGCCGAAGGAATTATTTGCTGATTATGCTGCTG
GCAAGCTAAAGATTGCACTAAAGACTCCGCCCGTAGTGTATCAACCTTTAGTCAAAAAAGAGCATATCGAACAAGCGCAA
CTAATGAACAACTATCTATTAGCGCTTGATAACGAAACTAACCCTCGGTCTCGTACAACAATGAAAAAAGTAATTTCGCA
AGTTGCGGATAAGTACGATTACAAGGGAGCACAAATACCATCAGATTCGAAACTATACCGCTGGTATAACGAGTGGGTAG
AGAATGATCGCAACGTGATTCCACTCGTCGTTAAAGGCATTAAAAAACGAAAAGCACAGATTGAAGAGTGCGTTTTCGAT
TTAGCAGATCAATGCATATGGGATGAATACTTGAAGATCAACGGGGCGGACAAAGCGGAAGTGTATCGCGTCTATCAAAA
GCGTCATCAAGAGACGTATCCTGAACTTCGTAGCATTGGTAAATCTCGCTTTTATGAGTTGTTTAAAGAACTATGCCCTG
TCGAAGTTACTATTGCACGTGAGGGGCGTGATGCTGCAAGAAAATTCAAACGCATTGCATTAAAAAAGTTTGTTGCTAAG
TTCATGGGTGAACGCGCTGAAATTGATGCTGTACATCTAAAGGTCGGTATCTACGATGCAGCGACTGGTGCCTATTTGGG
TTGCCCAACCGTCTATTTAGCGATCGATGTCTATACCAGATACATCATCGGATACAGCATCAGCTACAGCAACAAAGGTT
CGGAAACAGCAGCAGCTGTCATTGAGTGCTTAAAGCACGTAGCACTGCCGAAGCAAGATAAGGATTATCTATCCAATTCG
TGGGAGTATTTAGGTATACCGACTTACATAGCCGGAGATGCTGGTACTGCATTTCGTGCGAAACAAGTCATATCGCTGCT
TGCCACTATGCGTTGTGAATACAACACAACTGAGACTGGTACCCCATGGAAAAAGCCATTTGTTGAGAGATTCAACCGTA
CTCTCAGAGCCCAATTCGCTAAAAAGCTCGATGGTTACATAGGTCGTCGCTCTGACGGAAAACAGTACGACAAAACCATT
CAGCAAATGGCTAAACTGAATGACCAAGAGTTTCGAGAGAATCTCGAGAAGTATCTTGTCGACGTTTATCACCAAAACCC
ACATAGAGGGCTGGAAGGTCTATCTCCAGCACAAGCGGTTGCAGCAGCGCAAAGAGTAACATGTCCCGCTATAGCACCTG
ATGCTAGCAAACTTGATGCGCTCGGCGGTCAAGAGCTGACGGGCAAAATCAGCCCGCACGAAGGACTGCGCAAAAATAAT
TTACACTATACCCGTGATCATTGA

Upstream 100 bases:

>100_bases
GTGAAAATGCGTCTTGTGCGTGGGCTTTAGTCGCTAACCAATCTCTTAAATTTAACAACCACAAACTACTTACTCGTCAA
ACAACAGTTGAGGTAGCTGC

Downstream 100 bases:

>100_bases
AGTTGCTTGATTTTCAATAGAATCAGGATCATGCTACGCATCATGAAAATTACACTGACTCCTCAACAGAAACTACAACT
CGAACAAACACACGATTCGA

Product: hypothetical protein

Products: NA

Alternate protein names: Transposase; Integrase Catalytic Subunit; Integrase; Transposase-Like Mu; Transposase OrfA; TniA-Like Transposition Protein; Integrase Catalytic Domain

Number of amino acids: Translated: 487; Mature: 487

Protein sequence:

>487_residues
MNGTYILEAGMNISWHNQSYLIRALEPDFIVLENNKGQKMMQKPKELFADYAAGKLKIALKTPPVVYQPLVKKEHIEQAQ
LMNNYLLALDNETNPRSRTTMKKVISQVADKYDYKGAQIPSDSKLYRWYNEWVENDRNVIPLVVKGIKKRKAQIEECVFD
LADQCIWDEYLKINGADKAEVYRVYQKRHQETYPELRSIGKSRFYELFKELCPVEVTIAREGRDAARKFKRIALKKFVAK
FMGERAEIDAVHLKVGIYDAATGAYLGCPTVYLAIDVYTRYIIGYSISYSNKGSETAAAVIECLKHVALPKQDKDYLSNS
WEYLGIPTYIAGDAGTAFRAKQVISLLATMRCEYNTTETGTPWKKPFVERFNRTLRAQFAKKLDGYIGRRSDGKQYDKTI
QQMAKLNDQEFRENLEKYLVDVYHQNPHRGLEGLSPAQAVAAAQRVTCPAIAPDASKLDALGGQELTGKISPHEGLRKNN
LHYTRDH

Sequences:

>Translated_487_residues
MNGTYILEAGMNISWHNQSYLIRALEPDFIVLENNKGQKMMQKPKELFADYAAGKLKIALKTPPVVYQPLVKKEHIEQAQ
LMNNYLLALDNETNPRSRTTMKKVISQVADKYDYKGAQIPSDSKLYRWYNEWVENDRNVIPLVVKGIKKRKAQIEECVFD
LADQCIWDEYLKINGADKAEVYRVYQKRHQETYPELRSIGKSRFYELFKELCPVEVTIAREGRDAARKFKRIALKKFVAK
FMGERAEIDAVHLKVGIYDAATGAYLGCPTVYLAIDVYTRYIIGYSISYSNKGSETAAAVIECLKHVALPKQDKDYLSNS
WEYLGIPTYIAGDAGTAFRAKQVISLLATMRCEYNTTETGTPWKKPFVERFNRTLRAQFAKKLDGYIGRRSDGKQYDKTI
QQMAKLNDQEFRENLEKYLVDVYHQNPHRGLEGLSPAQAVAAAQRVTCPAIAPDASKLDALGGQELTGKISPHEGLRKNN
LHYTRDH
>Mature_487_residues
MNGTYILEAGMNISWHNQSYLIRALEPDFIVLENNKGQKMMQKPKELFADYAAGKLKIALKTPPVVYQPLVKKEHIEQAQ
LMNNYLLALDNETNPRSRTTMKKVISQVADKYDYKGAQIPSDSKLYRWYNEWVENDRNVIPLVVKGIKKRKAQIEECVFD
LADQCIWDEYLKINGADKAEVYRVYQKRHQETYPELRSIGKSRFYELFKELCPVEVTIAREGRDAARKFKRIALKKFVAK
FMGERAEIDAVHLKVGIYDAATGAYLGCPTVYLAIDVYTRYIIGYSISYSNKGSETAAAVIECLKHVALPKQDKDYLSNS
WEYLGIPTYIAGDAGTAFRAKQVISLLATMRCEYNTTETGTPWKKPFVERFNRTLRAQFAKKLDGYIGRRSDGKQYDKTI
QQMAKLNDQEFRENLEKYLVDVYHQNPHRGLEGLSPAQAVAAAQRVTCPAIAPDASKLDALGGQELTGKISPHEGLRKNN
LHYTRDH

Specific function: Unknown

COG id: COG2801

COG function: function code L; Transposase and inactivated derivatives

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 55669; Mature: 55669

Theoretical pI: Translated: 9.41; Mature: 9.41

Prosite motif: PS50994 INTEGRASE

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.4 %Cys     (Translated Protein)
1.8 %Met     (Translated Protein)
3.3 %Cys+Met (Translated Protein)
1.4 %Cys     (Mature Protein)
1.8 %Met     (Mature Protein)
3.3 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MNGTYILEAGMNISWHNQSYLIRALEPDFIVLENNKGQKMMQKPKELFADYAAGKLKIAL
CCCCEEEECCCEEEECCCCEEEEEECCCEEEEECCCCHHHHHHHHHHHHHHCCCEEEEEE
KTPPVVYQPLVKKEHIEQAQLMNNYLLALDNETNPRSRTTMKKVISQVADKYDYKGAQIP
ECCCHHHHHHHHHHHHHHHHHHCCEEEEECCCCCCHHHHHHHHHHHHHHHHHCCCCCCCC
SDSKLYRWYNEWVENDRNVIPLVVKGIKKRKAQIEECVFDLADQCIWDEYLKINGADKAE
CCHHHHHHHHHHHHCCCCEEHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHH
VYRVYQKRHQETYPELRSIGKSRFYELFKELCPVEVTIAREGRDAARKFKRIALKKFVAK
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCEEEEEECCCHHHHHHHHHHHHHHHHHH
FMGERAEIDAVHLKVGIYDAATGAYLGCPTVYLAIDVYTRYIIGYSISYSNKGSETAAAV
HCCCCCCEEEEEEEEEEEECCCCCCCCCCHHHHHHHHHHHHHHHEEEECCCCCCHHHHHH
IECLKHVALPKQDKDYLSNSWEYLGIPTYIAGDAGTAFRAKQVISLLATMRCEYNTTETG
HHHHHHHCCCCCCHHHHHCCCCEECCCEEEECCCCCHHHHHHHHHHHHHHHCCCCCCCCC
TPWKKPFVERFNRTLRAQFAKKLDGYIGRRSDGKQYDKTIQQMAKLNDQEFRENLEKYLV
CCCCHHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHCCHHHHHHHHHHHHH
DVYHQNPHRGLEGLSPAQAVAAAQRVTCPAIAPDASKLDALGGQELTGKISPHEGLRKNN
HHHHCCCCCCCCCCCHHHHHHHHHHCCCCCCCCCHHHHHHCCCCCCCCCCCCCCCCCCCC
LHYTRDH
CCCCCCC
>Mature Secondary Structure
MNGTYILEAGMNISWHNQSYLIRALEPDFIVLENNKGQKMMQKPKELFADYAAGKLKIAL
CCCCEEEECCCEEEECCCCEEEEEECCCEEEEECCCCHHHHHHHHHHHHHHCCCEEEEEE
KTPPVVYQPLVKKEHIEQAQLMNNYLLALDNETNPRSRTTMKKVISQVADKYDYKGAQIP
ECCCHHHHHHHHHHHHHHHHHHCCEEEEECCCCCCHHHHHHHHHHHHHHHHHCCCCCCCC
SDSKLYRWYNEWVENDRNVIPLVVKGIKKRKAQIEECVFDLADQCIWDEYLKINGADKAE
CCHHHHHHHHHHHHCCCCEEHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHH
VYRVYQKRHQETYPELRSIGKSRFYELFKELCPVEVTIAREGRDAARKFKRIALKKFVAK
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCEEEEEECCCHHHHHHHHHHHHHHHHHH
FMGERAEIDAVHLKVGIYDAATGAYLGCPTVYLAIDVYTRYIIGYSISYSNKGSETAAAV
HCCCCCCEEEEEEEEEEEECCCCCCCCCCHHHHHHHHHHHHHHHEEEECCCCCCHHHHHH
IECLKHVALPKQDKDYLSNSWEYLGIPTYIAGDAGTAFRAKQVISLLATMRCEYNTTETG
HHHHHHHCCCCCCHHHHHCCCCEECCCEEEECCCCCHHHHHHHHHHHHHHHCCCCCCCCC
TPWKKPFVERFNRTLRAQFAKKLDGYIGRRSDGKQYDKTIQQMAKLNDQEFRENLEKYLV
CCCCHHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHCCHHHHHHHHHHHHH
DVYHQNPHRGLEGLSPAQAVAAAQRVTCPAIAPDASKLDALGGQELTGKISPHEGLRKNN
HHHHCCCCCCCCCCCHHHHHHHHHHCCCCCCCCCHHHHHHCCCCCCCCCCCCCCCCCCCC
LHYTRDH
CCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA