Definition Kosmotoga olearia TBF 19.5.1, complete genome.
Accession NC_012785
Length 2,302,126

Click here to switch to the map view.

The map label for this gene is ina [H]

Identifier: 239616826

GI number: 239616826

Start: 447632

End: 449515

Strand: Reverse

Name: ina [H]

Synonym: Kole_0419

Alternate gene names: 239616826

Gene position: 449515-447632 (Counterclockwise)

Preceding gene: 239616827

Following gene: 239616825

Centisome position: 19.53

GC content: 44.85

Gene sequence:

>1884_bases
ATGAAGAAAGCTATTATTGTTTTTTTGCTCTTAATAGTAACTTCTTTAGCCTTTTCTGTTCCGGCATATCCGGGAGAGAT
AGCGCTTTCTCAACCCGATGGAACGATTTTAACGGTTAGGGTTATAGGTGATGAATTTGCACACGTCACCCTTTATAATG
GATTTCCGATAATAAAGAATGTTGACACCGGTTGGTGGGAATACGCAGTTTTCGATGAAATTGGTAAATTGATACCTTCG
GGGAGTAAAGCTGGTATTGATGCTCTTCCAGAACTCTTTGAGATTTCAACGGTTTATGATTATCTGAGCGCGGTGGAAAG
ACCTCAATATGTTGCCTGTGCCCCAACATCCGGTGTGCTGAAATTTCCGGTAATACTCGTGAACTTTTCTGATACAACCC
CCACATACACGCCCGATGATATTGAACCGGTCTTTACCGGAGATTCCAATTCGGTAAAAAGCTATTATCTTGAGGTTTCT
GGTGGAGAAGATACTCTTAAGCTTGAGTTTGTTGTTGTAGGTTGGTACACAGTATCCGCAACACATGGTTATTACGGAGA
GGATGATGCCCATTGTTGGGAACTTGTAAGAGAGGCAGTGCAACTTGCGGACAACGATGATTTCGACTTTTCACAGTTTG
ATAACGATGGTGATGGTTATGTTGATAGTATCATCGTGATTCATCAGGGTGAGGGCCAGGAATTATCGGGAGATCCATAT
GATATATGGTCACACAGCGGGGATATCTGGCCGTACTTGTATTTAGACGGTGTGTATATAAAACATTACACGATCCAGCC
GGAAACGGTGGGAGGAAAGTTGTTGACAATCGGGGTTGCCTGTCATGAACTCGGGCACGTTTTCGGGTTGCCAGATCTGT
ATGACACTGATTACAGTTCTGATGGAATTGGTTTATGGGGGCTGATGGCTGCTGGAGCATGGAATGGCATACACAGAGCT
GCGGATTCCCCTGCCCATATGTGTGCCTGGAGCAAGAAAGAACTTGGTTGGGTAACGGTTGGTTCCTTGAATGGATTCAA
CGGCCATGAATTATTATCTCCAGTTGAAACCAACTTCGAGGTCCTGATGTTCGAAAATGCAGACCGTCCAGCCGGAGAAG
AGTACTTTCTTTTAGAAAACCGTCAGTTGCTTGGCTACGATGCGGCTCTTCCGGGCGCGGGGTTGTTGATTTACCATATC
GATGAAGATGCTTATCAGACCAATGATTTGCATAGAAGGGTAGATGTCGAAGAAGCGGATGACGACAATGCCCTTGATAC
TTACGGTGGAGATAATGGTTCTGCTGGCGATCCGTTCCCTGGAACTTCGGCAAATATTGAATTTGGTCCCGGCACTTCGC
CAAGTTCGACATTCTACGATGGAACCTCAAAACTCAGTGTTGAAAATATAACTGTAAATGGTCTTGATATTGAATTTGAC
GTTCGTACCGGTGTGGTACTCAAAGCACCGCTGCCATATGTTATTTATGGAGAATCGAACACACTGGTGTATGAATTCAT
TTCCGAGATAGTGTCTTACAACCTGATTTCTCAGGATGCAACTATAATAGATTGCACACTTGCCCCCGATAGGCTTTCTT
TGGATGTCCAGGTGCTGTCACCTGATCATCCCTTTGAGCTGACGCTTGAAGCGACGGATGGAACTGGCGAAAGTGAAGTC
CTGACCCAGAGGTTCTTGCCTTTCATTTATCTAATTGTTCATGACGGTGTCTCTGAAAATCATCTTATCACTGTAAAAGA
ATTGAACTGGGATGAGGTTGAGTATGAGGCGCCTGACGGTACCTGGAACGGTGACGCACCGCTTTACTGGAAGTGGATAG
ATTCGTTGCCTGTCGAAGTATTTGGTCATCAATTGGAGGAGTGA

Upstream 100 bases:

>100_bases
ATACATGCACATGATGATGCGGCTTATAGTACTTATACAGGTATGATTACGGATCAGGATTTTGTTGATCGCCTCGAACA
ACTGAAAGGGGGCGAGTAAA

Downstream 100 bases:

>100_bases
AACCAGAATAAGCAGCAAATGCCCGCCTTTTGGCGGGCTTTTTTAGTTTTGAACGAACATTCTTTTTAGGTGGTCAAAGA
ATTGTTAGCATAAGTCTTTG

Product: M6 family metalloprotease domain protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 627; Mature: 627

Protein sequence:

>627_residues
MKKAIIVFLLLIVTSLAFSVPAYPGEIALSQPDGTILTVRVIGDEFAHVTLYNGFPIIKNVDTGWWEYAVFDEIGKLIPS
GSKAGIDALPELFEISTVYDYLSAVERPQYVACAPTSGVLKFPVILVNFSDTTPTYTPDDIEPVFTGDSNSVKSYYLEVS
GGEDTLKLEFVVVGWYTVSATHGYYGEDDAHCWELVREAVQLADNDDFDFSQFDNDGDGYVDSIIVIHQGEGQELSGDPY
DIWSHSGDIWPYLYLDGVYIKHYTIQPETVGGKLLTIGVACHELGHVFGLPDLYDTDYSSDGIGLWGLMAAGAWNGIHRA
ADSPAHMCAWSKKELGWVTVGSLNGFNGHELLSPVETNFEVLMFENADRPAGEEYFLLENRQLLGYDAALPGAGLLIYHI
DEDAYQTNDLHRRVDVEEADDDNALDTYGGDNGSAGDPFPGTSANIEFGPGTSPSSTFYDGTSKLSVENITVNGLDIEFD
VRTGVVLKAPLPYVIYGESNTLVYEFISEIVSYNLISQDATIIDCTLAPDRLSLDVQVLSPDHPFELTLEATDGTGESEV
LTQRFLPFIYLIVHDGVSENHLITVKELNWDEVEYEAPDGTWNGDAPLYWKWIDSLPVEVFGHQLEE

Sequences:

>Translated_627_residues
MKKAIIVFLLLIVTSLAFSVPAYPGEIALSQPDGTILTVRVIGDEFAHVTLYNGFPIIKNVDTGWWEYAVFDEIGKLIPS
GSKAGIDALPELFEISTVYDYLSAVERPQYVACAPTSGVLKFPVILVNFSDTTPTYTPDDIEPVFTGDSNSVKSYYLEVS
GGEDTLKLEFVVVGWYTVSATHGYYGEDDAHCWELVREAVQLADNDDFDFSQFDNDGDGYVDSIIVIHQGEGQELSGDPY
DIWSHSGDIWPYLYLDGVYIKHYTIQPETVGGKLLTIGVACHELGHVFGLPDLYDTDYSSDGIGLWGLMAAGAWNGIHRA
ADSPAHMCAWSKKELGWVTVGSLNGFNGHELLSPVETNFEVLMFENADRPAGEEYFLLENRQLLGYDAALPGAGLLIYHI
DEDAYQTNDLHRRVDVEEADDDNALDTYGGDNGSAGDPFPGTSANIEFGPGTSPSSTFYDGTSKLSVENITVNGLDIEFD
VRTGVVLKAPLPYVIYGESNTLVYEFISEIVSYNLISQDATIIDCTLAPDRLSLDVQVLSPDHPFELTLEATDGTGESEV
LTQRFLPFIYLIVHDGVSENHLITVKELNWDEVEYEAPDGTWNGDAPLYWKWIDSLPVEVFGHQLEE
>Mature_627_residues
MKKAIIVFLLLIVTSLAFSVPAYPGEIALSQPDGTILTVRVIGDEFAHVTLYNGFPIIKNVDTGWWEYAVFDEIGKLIPS
GSKAGIDALPELFEISTVYDYLSAVERPQYVACAPTSGVLKFPVILVNFSDTTPTYTPDDIEPVFTGDSNSVKSYYLEVS
GGEDTLKLEFVVVGWYTVSATHGYYGEDDAHCWELVREAVQLADNDDFDFSQFDNDGDGYVDSIIVIHQGEGQELSGDPY
DIWSHSGDIWPYLYLDGVYIKHYTIQPETVGGKLLTIGVACHELGHVFGLPDLYDTDYSSDGIGLWGLMAAGAWNGIHRA
ADSPAHMCAWSKKELGWVTVGSLNGFNGHELLSPVETNFEVLMFENADRPAGEEYFLLENRQLLGYDAALPGAGLLIYHI
DEDAYQTNDLHRRVDVEEADDDNALDTYGGDNGSAGDPFPGTSANIEFGPGTSPSSTFYDGTSKLSVENITVNGLDIEFD
VRTGVVLKAPLPYVIYGESNTLVYEFISEIVSYNLISQDATIIDCTLAPDRLSLDVQVLSPDHPFELTLEATDGTGESEV
LTQRFLPFIYLIVHDGVSENHLITVKELNWDEVEYEAPDGTWNGDAPLYWKWIDSLPVEVFGHQLEE

Specific function: Neutral metalloprotease that is secreted to degrade antibacterial proteins produced by the insect host for its defense (attacins and cecropins). Probably degrades some unknown crucial protein(s) too, since it is toxic when injected to insect larvae [H]

COG id: NA

COG function: NA

Gene ontology:

Cell location: Secreted [H]

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Belongs to the peptidase M6 family [H]

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR012300
- InterPro:   IPR008757 [H]

Pfam domain/function: PF05547 Peptidase_M6 [H]

EC number: NA

Molecular weight: Translated: 69153; Mature: 69153

Theoretical pI: Translated: 3.87; Mature: 3.87

Prosite motif: PS00142 ZINC_PROTEASE

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.8 %Cys     (Translated Protein)
0.6 %Met     (Translated Protein)
1.4 %Cys+Met (Translated Protein)
0.8 %Cys     (Mature Protein)
0.6 %Met     (Mature Protein)
1.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKKAIIVFLLLIVTSLAFSVPAYPGEIALSQPDGTILTVRVIGDEFAHVTLYNGFPIIKN
CCHHHHHHHHHHHHHHHHCCCCCCCCEEEECCCCCEEEEEEECCCEEEEEEECCCCEEEE
VDTGWWEYAVFDEIGKLIPSGSKAGIDALPELFEISTVYDYLSAVERPQYVACAPTSGVL
CCCCCEEEHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCEEEECCCCCCE
KFPVILVNFSDTTPTYTPDDIEPVFTGDSNSVKSYYLEVSGGEDTLKLEFVVVGWYTVSA
EEEEEEEEECCCCCCCCCCCCCEEEECCCCCEEEEEEEEECCCCEEEEEEEEEEEEEEEE
THGYYGEDDAHCWELVREAVQLADNDDFDFSQFDNDGDGYVDSIIVIHQGEGQELSGDPY
CCCCCCCCHHHHHHHHHHHHHHCCCCCCCHHHCCCCCCCEEEEEEEEECCCCCCCCCCCC
DIWSHSGDIWPYLYLDGVYIKHYTIQPETVGGKLLTIGVACHELGHVFGLPDLYDTDYSS
CHHCCCCCCCEEEEECCEEEEEEEECCCCCCCEEEEEEHHHHHHHHHCCCCCCCCCCCCC
DGIGLWGLMAAGAWNGIHRAADSPAHMCAWSKKELGWVTVGSLNGFNGHELLSPVETNFE
CCCCHHHHHHHCCCCCHHHHCCCCHHHEECCCCCCCEEEEECCCCCCCHHHCCCCCCCEE
VLMFENADRPAGEEYFLLENRQLLGYDAALPGAGLLIYHIDEDAYQTNDLHRRVDVEEAD
EEEEECCCCCCCCEEEEEECCEEEEECCCCCCCCEEEEEECCCCCCCCCHHHEECCCCCC
DDNALDTYGGDNGSAGDPFPGTSANIEFGPGTSPSSTFYDGTSKLSVENITVNGLDIEFD
CCCCCCCCCCCCCCCCCCCCCCCCEEEECCCCCCCCCEECCCCEEEEEEEEEECEEEEEE
VRTGVVLKAPLPYVIYGESNTLVYEFISEIVSYNLISQDATIIDCTLAPDRLSLDVQVLS
ECCCEEEECCCCEEEECCCCEEHHHHHHHHHHHHEECCCCEEEEEEECCCCEEEEEEEEC
PDHPFELTLEATDGTGESEVLTQRFLPFIYLIVHDGVSENHLITVKELNWDEVEYEAPDG
CCCCEEEEEEECCCCCHHHHHHHHHHHEEEEEEECCCCCCEEEEEEECCCCEEEEECCCC
TWNGDAPLYWKWIDSLPVEVFGHQLEE
CCCCCCCEEEEECCCCCHHHHHHHHCC
>Mature Secondary Structure
MKKAIIVFLLLIVTSLAFSVPAYPGEIALSQPDGTILTVRVIGDEFAHVTLYNGFPIIKN
CCHHHHHHHHHHHHHHHHCCCCCCCCEEEECCCCCEEEEEEECCCEEEEEEECCCCEEEE
VDTGWWEYAVFDEIGKLIPSGSKAGIDALPELFEISTVYDYLSAVERPQYVACAPTSGVL
CCCCCEEEHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCEEEECCCCCCE
KFPVILVNFSDTTPTYTPDDIEPVFTGDSNSVKSYYLEVSGGEDTLKLEFVVVGWYTVSA
EEEEEEEEECCCCCCCCCCCCCEEEECCCCCEEEEEEEEECCCCEEEEEEEEEEEEEEEE
THGYYGEDDAHCWELVREAVQLADNDDFDFSQFDNDGDGYVDSIIVIHQGEGQELSGDPY
CCCCCCCCHHHHHHHHHHHHHHCCCCCCCHHHCCCCCCCEEEEEEEEECCCCCCCCCCCC
DIWSHSGDIWPYLYLDGVYIKHYTIQPETVGGKLLTIGVACHELGHVFGLPDLYDTDYSS
CHHCCCCCCCEEEEECCEEEEEEEECCCCCCCEEEEEEHHHHHHHHHCCCCCCCCCCCCC
DGIGLWGLMAAGAWNGIHRAADSPAHMCAWSKKELGWVTVGSLNGFNGHELLSPVETNFE
CCCCHHHHHHHCCCCCHHHHCCCCHHHEECCCCCCCEEEEECCCCCCCHHHCCCCCCCEE
VLMFENADRPAGEEYFLLENRQLLGYDAALPGAGLLIYHIDEDAYQTNDLHRRVDVEEAD
EEEEECCCCCCCCEEEEEECCEEEEECCCCCCCCEEEEEECCCCCCCCCHHHEECCCCCC
DDNALDTYGGDNGSAGDPFPGTSANIEFGPGTSPSSTFYDGTSKLSVENITVNGLDIEFD
CCCCCCCCCCCCCCCCCCCCCCCCEEEECCCCCCCCCEECCCCEEEEEEEEEECEEEEEE
VRTGVVLKAPLPYVIYGESNTLVYEFISEIVSYNLISQDATIIDCTLAPDRLSLDVQVLS
ECCCEEEECCCCEEEECCCCEEHHHHHHHHHHHHEECCCCEEEEEEECCCCEEEEEEEEC
PDHPFELTLEATDGTGESEVLTQRFLPFIYLIVHDGVSENHLITVKELNWDEVEYEAPDG
CCCCEEEEEEECCCCCHHHHHHHHHHHEEEEEEECCCCCCEEEEEEECCCCEEEEECCCC
TWNGDAPLYWKWIDSLPVEVFGHQLEE
CCCCCCCEEEEECCCCCHHHHHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 2089225; 6421577 [H]