| Definition | Kosmotoga olearia TBF 19.5.1, complete genome. |
|---|---|
| Accession | NC_012785 |
| Length | 2,302,126 |
Click here to switch to the map view.
The map label for this gene is ina [H]
Identifier: 239616826
GI number: 239616826
Start: 447632
End: 449515
Strand: Reverse
Name: ina [H]
Synonym: Kole_0419
Alternate gene names: 239616826
Gene position: 449515-447632 (Counterclockwise)
Preceding gene: 239616827
Following gene: 239616825
Centisome position: 19.53
GC content: 44.85
Gene sequence:
>1884_bases ATGAAGAAAGCTATTATTGTTTTTTTGCTCTTAATAGTAACTTCTTTAGCCTTTTCTGTTCCGGCATATCCGGGAGAGAT AGCGCTTTCTCAACCCGATGGAACGATTTTAACGGTTAGGGTTATAGGTGATGAATTTGCACACGTCACCCTTTATAATG GATTTCCGATAATAAAGAATGTTGACACCGGTTGGTGGGAATACGCAGTTTTCGATGAAATTGGTAAATTGATACCTTCG GGGAGTAAAGCTGGTATTGATGCTCTTCCAGAACTCTTTGAGATTTCAACGGTTTATGATTATCTGAGCGCGGTGGAAAG ACCTCAATATGTTGCCTGTGCCCCAACATCCGGTGTGCTGAAATTTCCGGTAATACTCGTGAACTTTTCTGATACAACCC CCACATACACGCCCGATGATATTGAACCGGTCTTTACCGGAGATTCCAATTCGGTAAAAAGCTATTATCTTGAGGTTTCT GGTGGAGAAGATACTCTTAAGCTTGAGTTTGTTGTTGTAGGTTGGTACACAGTATCCGCAACACATGGTTATTACGGAGA GGATGATGCCCATTGTTGGGAACTTGTAAGAGAGGCAGTGCAACTTGCGGACAACGATGATTTCGACTTTTCACAGTTTG ATAACGATGGTGATGGTTATGTTGATAGTATCATCGTGATTCATCAGGGTGAGGGCCAGGAATTATCGGGAGATCCATAT GATATATGGTCACACAGCGGGGATATCTGGCCGTACTTGTATTTAGACGGTGTGTATATAAAACATTACACGATCCAGCC GGAAACGGTGGGAGGAAAGTTGTTGACAATCGGGGTTGCCTGTCATGAACTCGGGCACGTTTTCGGGTTGCCAGATCTGT ATGACACTGATTACAGTTCTGATGGAATTGGTTTATGGGGGCTGATGGCTGCTGGAGCATGGAATGGCATACACAGAGCT GCGGATTCCCCTGCCCATATGTGTGCCTGGAGCAAGAAAGAACTTGGTTGGGTAACGGTTGGTTCCTTGAATGGATTCAA CGGCCATGAATTATTATCTCCAGTTGAAACCAACTTCGAGGTCCTGATGTTCGAAAATGCAGACCGTCCAGCCGGAGAAG AGTACTTTCTTTTAGAAAACCGTCAGTTGCTTGGCTACGATGCGGCTCTTCCGGGCGCGGGGTTGTTGATTTACCATATC GATGAAGATGCTTATCAGACCAATGATTTGCATAGAAGGGTAGATGTCGAAGAAGCGGATGACGACAATGCCCTTGATAC TTACGGTGGAGATAATGGTTCTGCTGGCGATCCGTTCCCTGGAACTTCGGCAAATATTGAATTTGGTCCCGGCACTTCGC CAAGTTCGACATTCTACGATGGAACCTCAAAACTCAGTGTTGAAAATATAACTGTAAATGGTCTTGATATTGAATTTGAC GTTCGTACCGGTGTGGTACTCAAAGCACCGCTGCCATATGTTATTTATGGAGAATCGAACACACTGGTGTATGAATTCAT TTCCGAGATAGTGTCTTACAACCTGATTTCTCAGGATGCAACTATAATAGATTGCACACTTGCCCCCGATAGGCTTTCTT TGGATGTCCAGGTGCTGTCACCTGATCATCCCTTTGAGCTGACGCTTGAAGCGACGGATGGAACTGGCGAAAGTGAAGTC CTGACCCAGAGGTTCTTGCCTTTCATTTATCTAATTGTTCATGACGGTGTCTCTGAAAATCATCTTATCACTGTAAAAGA ATTGAACTGGGATGAGGTTGAGTATGAGGCGCCTGACGGTACCTGGAACGGTGACGCACCGCTTTACTGGAAGTGGATAG ATTCGTTGCCTGTCGAAGTATTTGGTCATCAATTGGAGGAGTGA
Upstream 100 bases:
>100_bases ATACATGCACATGATGATGCGGCTTATAGTACTTATACAGGTATGATTACGGATCAGGATTTTGTTGATCGCCTCGAACA ACTGAAAGGGGGCGAGTAAA
Downstream 100 bases:
>100_bases AACCAGAATAAGCAGCAAATGCCCGCCTTTTGGCGGGCTTTTTTAGTTTTGAACGAACATTCTTTTTAGGTGGTCAAAGA ATTGTTAGCATAAGTCTTTG
Product: M6 family metalloprotease domain protein
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 627; Mature: 627
Protein sequence:
>627_residues MKKAIIVFLLLIVTSLAFSVPAYPGEIALSQPDGTILTVRVIGDEFAHVTLYNGFPIIKNVDTGWWEYAVFDEIGKLIPS GSKAGIDALPELFEISTVYDYLSAVERPQYVACAPTSGVLKFPVILVNFSDTTPTYTPDDIEPVFTGDSNSVKSYYLEVS GGEDTLKLEFVVVGWYTVSATHGYYGEDDAHCWELVREAVQLADNDDFDFSQFDNDGDGYVDSIIVIHQGEGQELSGDPY DIWSHSGDIWPYLYLDGVYIKHYTIQPETVGGKLLTIGVACHELGHVFGLPDLYDTDYSSDGIGLWGLMAAGAWNGIHRA ADSPAHMCAWSKKELGWVTVGSLNGFNGHELLSPVETNFEVLMFENADRPAGEEYFLLENRQLLGYDAALPGAGLLIYHI DEDAYQTNDLHRRVDVEEADDDNALDTYGGDNGSAGDPFPGTSANIEFGPGTSPSSTFYDGTSKLSVENITVNGLDIEFD VRTGVVLKAPLPYVIYGESNTLVYEFISEIVSYNLISQDATIIDCTLAPDRLSLDVQVLSPDHPFELTLEATDGTGESEV LTQRFLPFIYLIVHDGVSENHLITVKELNWDEVEYEAPDGTWNGDAPLYWKWIDSLPVEVFGHQLEE
Sequences:
>Translated_627_residues MKKAIIVFLLLIVTSLAFSVPAYPGEIALSQPDGTILTVRVIGDEFAHVTLYNGFPIIKNVDTGWWEYAVFDEIGKLIPS GSKAGIDALPELFEISTVYDYLSAVERPQYVACAPTSGVLKFPVILVNFSDTTPTYTPDDIEPVFTGDSNSVKSYYLEVS GGEDTLKLEFVVVGWYTVSATHGYYGEDDAHCWELVREAVQLADNDDFDFSQFDNDGDGYVDSIIVIHQGEGQELSGDPY DIWSHSGDIWPYLYLDGVYIKHYTIQPETVGGKLLTIGVACHELGHVFGLPDLYDTDYSSDGIGLWGLMAAGAWNGIHRA ADSPAHMCAWSKKELGWVTVGSLNGFNGHELLSPVETNFEVLMFENADRPAGEEYFLLENRQLLGYDAALPGAGLLIYHI DEDAYQTNDLHRRVDVEEADDDNALDTYGGDNGSAGDPFPGTSANIEFGPGTSPSSTFYDGTSKLSVENITVNGLDIEFD VRTGVVLKAPLPYVIYGESNTLVYEFISEIVSYNLISQDATIIDCTLAPDRLSLDVQVLSPDHPFELTLEATDGTGESEV LTQRFLPFIYLIVHDGVSENHLITVKELNWDEVEYEAPDGTWNGDAPLYWKWIDSLPVEVFGHQLEE >Mature_627_residues MKKAIIVFLLLIVTSLAFSVPAYPGEIALSQPDGTILTVRVIGDEFAHVTLYNGFPIIKNVDTGWWEYAVFDEIGKLIPS GSKAGIDALPELFEISTVYDYLSAVERPQYVACAPTSGVLKFPVILVNFSDTTPTYTPDDIEPVFTGDSNSVKSYYLEVS GGEDTLKLEFVVVGWYTVSATHGYYGEDDAHCWELVREAVQLADNDDFDFSQFDNDGDGYVDSIIVIHQGEGQELSGDPY DIWSHSGDIWPYLYLDGVYIKHYTIQPETVGGKLLTIGVACHELGHVFGLPDLYDTDYSSDGIGLWGLMAAGAWNGIHRA ADSPAHMCAWSKKELGWVTVGSLNGFNGHELLSPVETNFEVLMFENADRPAGEEYFLLENRQLLGYDAALPGAGLLIYHI DEDAYQTNDLHRRVDVEEADDDNALDTYGGDNGSAGDPFPGTSANIEFGPGTSPSSTFYDGTSKLSVENITVNGLDIEFD VRTGVVLKAPLPYVIYGESNTLVYEFISEIVSYNLISQDATIIDCTLAPDRLSLDVQVLSPDHPFELTLEATDGTGESEV LTQRFLPFIYLIVHDGVSENHLITVKELNWDEVEYEAPDGTWNGDAPLYWKWIDSLPVEVFGHQLEE
Specific function: Neutral metalloprotease that is secreted to degrade antibacterial proteins produced by the insect host for its defense (attacins and cecropins). Probably degrades some unknown crucial protein(s) too, since it is toxic when injected to insect larvae [H]
COG id: NA
COG function: NA
Gene ontology:
Cell location: Secreted [H]
Metaboloic importance: NA
Operon status: Not Known
Operon components: None
Similarity: Belongs to the peptidase M6 family [H]
Homologues:
None
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR012300 - InterPro: IPR008757 [H]
Pfam domain/function: PF05547 Peptidase_M6 [H]
EC number: NA
Molecular weight: Translated: 69153; Mature: 69153
Theoretical pI: Translated: 3.87; Mature: 3.87
Prosite motif: PS00142 ZINC_PROTEASE
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.8 %Cys (Translated Protein) 0.6 %Met (Translated Protein) 1.4 %Cys+Met (Translated Protein) 0.8 %Cys (Mature Protein) 0.6 %Met (Mature Protein) 1.4 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MKKAIIVFLLLIVTSLAFSVPAYPGEIALSQPDGTILTVRVIGDEFAHVTLYNGFPIIKN CCHHHHHHHHHHHHHHHHCCCCCCCCEEEECCCCCEEEEEEECCCEEEEEEECCCCEEEE VDTGWWEYAVFDEIGKLIPSGSKAGIDALPELFEISTVYDYLSAVERPQYVACAPTSGVL CCCCCEEEHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCEEEECCCCCCE KFPVILVNFSDTTPTYTPDDIEPVFTGDSNSVKSYYLEVSGGEDTLKLEFVVVGWYTVSA EEEEEEEEECCCCCCCCCCCCCEEEECCCCCEEEEEEEEECCCCEEEEEEEEEEEEEEEE THGYYGEDDAHCWELVREAVQLADNDDFDFSQFDNDGDGYVDSIIVIHQGEGQELSGDPY CCCCCCCCHHHHHHHHHHHHHHCCCCCCCHHHCCCCCCCEEEEEEEEECCCCCCCCCCCC DIWSHSGDIWPYLYLDGVYIKHYTIQPETVGGKLLTIGVACHELGHVFGLPDLYDTDYSS CHHCCCCCCCEEEEECCEEEEEEEECCCCCCCEEEEEEHHHHHHHHHCCCCCCCCCCCCC DGIGLWGLMAAGAWNGIHRAADSPAHMCAWSKKELGWVTVGSLNGFNGHELLSPVETNFE CCCCHHHHHHHCCCCCHHHHCCCCHHHEECCCCCCCEEEEECCCCCCCHHHCCCCCCCEE VLMFENADRPAGEEYFLLENRQLLGYDAALPGAGLLIYHIDEDAYQTNDLHRRVDVEEAD EEEEECCCCCCCCEEEEEECCEEEEECCCCCCCCEEEEEECCCCCCCCCHHHEECCCCCC DDNALDTYGGDNGSAGDPFPGTSANIEFGPGTSPSSTFYDGTSKLSVENITVNGLDIEFD CCCCCCCCCCCCCCCCCCCCCCCCEEEECCCCCCCCCEECCCCEEEEEEEEEECEEEEEE VRTGVVLKAPLPYVIYGESNTLVYEFISEIVSYNLISQDATIIDCTLAPDRLSLDVQVLS ECCCEEEECCCCEEEECCCCEEHHHHHHHHHHHHEECCCCEEEEEEECCCCEEEEEEEEC PDHPFELTLEATDGTGESEVLTQRFLPFIYLIVHDGVSENHLITVKELNWDEVEYEAPDG CCCCEEEEEEECCCCCHHHHHHHHHHHEEEEEEECCCCCCEEEEEEECCCCEEEEECCCC TWNGDAPLYWKWIDSLPVEVFGHQLEE CCCCCCCEEEEECCCCCHHHHHHHHCC >Mature Secondary Structure MKKAIIVFLLLIVTSLAFSVPAYPGEIALSQPDGTILTVRVIGDEFAHVTLYNGFPIIKN CCHHHHHHHHHHHHHHHHCCCCCCCCEEEECCCCCEEEEEEECCCEEEEEEECCCCEEEE VDTGWWEYAVFDEIGKLIPSGSKAGIDALPELFEISTVYDYLSAVERPQYVACAPTSGVL CCCCCEEEHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCEEEECCCCCCE KFPVILVNFSDTTPTYTPDDIEPVFTGDSNSVKSYYLEVSGGEDTLKLEFVVVGWYTVSA EEEEEEEEECCCCCCCCCCCCCEEEECCCCCEEEEEEEEECCCCEEEEEEEEEEEEEEEE THGYYGEDDAHCWELVREAVQLADNDDFDFSQFDNDGDGYVDSIIVIHQGEGQELSGDPY CCCCCCCCHHHHHHHHHHHHHHCCCCCCCHHHCCCCCCCEEEEEEEEECCCCCCCCCCCC DIWSHSGDIWPYLYLDGVYIKHYTIQPETVGGKLLTIGVACHELGHVFGLPDLYDTDYSS CHHCCCCCCCEEEEECCEEEEEEEECCCCCCCEEEEEEHHHHHHHHHCCCCCCCCCCCCC DGIGLWGLMAAGAWNGIHRAADSPAHMCAWSKKELGWVTVGSLNGFNGHELLSPVETNFE CCCCHHHHHHHCCCCCHHHHCCCCHHHEECCCCCCCEEEEECCCCCCCHHHCCCCCCCEE VLMFENADRPAGEEYFLLENRQLLGYDAALPGAGLLIYHIDEDAYQTNDLHRRVDVEEAD EEEEECCCCCCCCEEEEEECCEEEEECCCCCCCCEEEEEECCCCCCCCCHHHEECCCCCC DDNALDTYGGDNGSAGDPFPGTSANIEFGPGTSPSSTFYDGTSKLSVENITVNGLDIEFD CCCCCCCCCCCCCCCCCCCCCCCCEEEECCCCCCCCCEECCCCEEEEEEEEEECEEEEEE VRTGVVLKAPLPYVIYGESNTLVYEFISEIVSYNLISQDATIIDCTLAPDRLSLDVQVLS ECCCEEEECCCCEEEECCCCEEHHHHHHHHHHHHEECCCCEEEEEEECCCCEEEEEEEEC PDHPFELTLEATDGTGESEVLTQRFLPFIYLIVHDGVSENHLITVKELNWDEVEYEAPDG CCCCEEEEEEECCCCCHHHHHHHHHHHEEEEEEECCCCCCEEEEEEECCCCEEEEECCCC TWNGDAPLYWKWIDSLPVEVFGHQLEE CCCCCCCEEEEECCCCCHHHHHHHHCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 2089225; 6421577 [H]