| Definition | Bacillus anthracis str. CDC 684, complete genome. |
|---|---|
| Accession | NC_012581 |
| Length | 5,230,115 |
Click here to switch to the map view.
The map label for this gene is ina [H]
Identifier: 227815876
GI number: 227815876
Start: 2996368
End: 2998431
Strand: Reverse
Name: ina [H]
Synonym: BAMEG_3301
Alternate gene names: 227815876
Gene position: 2998431-2996368 (Counterclockwise)
Preceding gene: 227815877
Following gene: 227815875
Centisome position: 57.33
GC content: 38.91
Gene sequence:
>2064_bases GTGAAAGATGCGAAAGCAGATACGAAAGAAAAGTTAGATAAACCTGCAACAGGAACACCTGCAGCGACAGGACCAGTTAG AGGTGGTCTAAATGGTAAAGTACCAACATCTCCAGCGAAGCAAAAAGCGTACAATGGTGATGTACGTAAAGATAAAGTAC TTGTTTTACTTGTAGAGTACGCTGACTTTAAACATAACAATATTGATAAAGAGCCTGGTTATATGTATTCGGAAGACTTT AACAAAGAACATTATGAAAAAATGTTATTCGGTGACGAGCCATTCACATTAGATGATGGAAGTAAAATCGAAACGTTTAA ACAATATTACGAAGAGCAATCTGGTGGTAGTTATACAGTAGATGGAACAGTTACAAAATGGTTAACAGTTCCTGGTAAAG CTGCTGATTACGGTGCAGATGCTGCTACTGGTCATGATAATAAAGGACCAAAAGGACCACGTGATTTAGTAAAAGATGCA TTAAAAGCTGCTGTAGATAGCGGTCTTGATTTATCAGAATTTGATCAATTTGACCAATATGATGTAAATGGTGATGGAAA TAAAAATCAACCAGATGGTTTAATTGACCACTTAATGATTATTCATGCAGGAGTTGGACAAGAAGCTGGTGGTGGTAAAT TAGGTGACGATGCAATTTGGTCACATCGCTGGACAGTTGGACCAAAACCATTCCCAATTGAAGGCACGCAAGCGAAAGTT CCATATTGGGGTGGAAAGATGGCAGCGTTTGACTACACAATTGAACCAGAAGATGGCGCGGTCGGTGTATTCGCACATGA ATATGGTCATGATTTAGGTTTACCAGATGAGTATGATACACAATATAGCGGTCATGGTGAACCAGTTCAAGCTTGGTCTA TTATGAGCGGCGGAAGCTGGGCAGGTAAAATCGCCGGAACGACGCCAACAAGTTTCTCACCACAAAATAAAGAGTTTTTC CAAAAAACAATTGGTGGTAACTGGGCAAATATCGTAGAAGTAGATTACGAGAAATTAAATAAAGGTATCGGTCTAGCAAC ATATTTAGACCAAAGTGTTACAAAAACGAACCGTCCAGGTATGATTCGTGTTAACTTACCGGATAAAGATATAAAAACAA TTGATCCAGCATTCGGAAAACAGTATTACTACAGTACAAAAGGTGACGATCTTCATACGAAGTTGGAAACACCACTGTTC GATTTAACGAATGCAACGACTGCGAAATTTGATTTTAAATCATTATATGAAATTGAAGCAGAGTATGACTTCCTTGAAGT ACACGCTGTAACAGAAGATGGTCAACAAACGTTAATCGAAAGACTTGGTGAGAAAGCAAATAATGGAAATGCAGATTCGA CAAATGGAAAATGGATTGATAAATCATATGATTTAAGCCAATTCAAAGGTAAGAAAGTAAAATTAACATTTGATTACATT ACTGATGGTGGTTTAGCATTAAACGGTTTCCTACTTGATAATGCTTCATTAACAGTAGATGGTAAAGTAGTATTCTCTGA TGATGCAGAAGGGACACCACAATTCAAATTAGATGGTTTTGCTGTTTCTAACGGAACAGAGAAGAAGAGCCATAACTACT ATGTTGAGTGGAGAAACTATGCTGGTTCTGATAACGCATTGAAATTTGCTCGCGGCCCAGAATATAACACTGGTATGGTT GTATGGTATGCAGATTCAGCTTACACAGATAACTGGGTTGGTGTACATCCAGGACACGGTTTCCTTGGTGTAGTCGATTC TCACCCAGAAGCAATTGTAGGAACTTTAAATGGTAAGCCGACAGTTGAAAGTAGTACACGATTCCAAATCGCTGATGCGG CGTTCTCATTCGATAAAACGCCAGCTTGGAAAGTTGTATCTCCAACGCGTGGAACGTATACGTATAATGGCTTAGCGGGT GTACCGAAGTTTGATGATTCGAAAACGTATATTAATCAACAGATTCCAGATGCAGGACGTATTTTACCAAATCTTGGCCT GAAGTTTGAAGTAGTAGGACAAGCTGATGATAATTCTGCAGGTGCTGTTCGCTTATATCGCTAA
Upstream 100 bases:
>100_bases TGTCGAAAAATATGTAGAGAATAAAAAGGGTGAAAATCCTGGGAAAGAAGTAACAAATGGGGACCCACTTACGAAAGAAG CATCTGACTTTGTAAAGAAA
Downstream 100 bases:
>100_bases TACAGTAAAACTACCGAAAGATTCTCTTTCGGTAGTTTTTTTGTGAGCAATGAATTTTATATAAAAGAAGAAATTATATA TAATGTAACTTTACGAATGA
Product: immune inhibitor A
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 687; Mature: 687
Protein sequence:
>687_residues MKDAKADTKEKLDKPATGTPAATGPVRGGLNGKVPTSPAKQKAYNGDVRKDKVLVLLVEYADFKHNNIDKEPGYMYSEDF NKEHYEKMLFGDEPFTLDDGSKIETFKQYYEEQSGGSYTVDGTVTKWLTVPGKAADYGADAATGHDNKGPKGPRDLVKDA LKAAVDSGLDLSEFDQFDQYDVNGDGNKNQPDGLIDHLMIIHAGVGQEAGGGKLGDDAIWSHRWTVGPKPFPIEGTQAKV PYWGGKMAAFDYTIEPEDGAVGVFAHEYGHDLGLPDEYDTQYSGHGEPVQAWSIMSGGSWAGKIAGTTPTSFSPQNKEFF QKTIGGNWANIVEVDYEKLNKGIGLATYLDQSVTKTNRPGMIRVNLPDKDIKTIDPAFGKQYYYSTKGDDLHTKLETPLF DLTNATTAKFDFKSLYEIEAEYDFLEVHAVTEDGQQTLIERLGEKANNGNADSTNGKWIDKSYDLSQFKGKKVKLTFDYI TDGGLALNGFLLDNASLTVDGKVVFSDDAEGTPQFKLDGFAVSNGTEKKSHNYYVEWRNYAGSDNALKFARGPEYNTGMV VWYADSAYTDNWVGVHPGHGFLGVVDSHPEAIVGTLNGKPTVESSTRFQIADAAFSFDKTPAWKVVSPTRGTYTYNGLAG VPKFDDSKTYINQQIPDAGRILPNLGLKFEVVGQADDNSAGAVRLYR
Sequences:
>Translated_687_residues MKDAKADTKEKLDKPATGTPAATGPVRGGLNGKVPTSPAKQKAYNGDVRKDKVLVLLVEYADFKHNNIDKEPGYMYSEDF NKEHYEKMLFGDEPFTLDDGSKIETFKQYYEEQSGGSYTVDGTVTKWLTVPGKAADYGADAATGHDNKGPKGPRDLVKDA LKAAVDSGLDLSEFDQFDQYDVNGDGNKNQPDGLIDHLMIIHAGVGQEAGGGKLGDDAIWSHRWTVGPKPFPIEGTQAKV PYWGGKMAAFDYTIEPEDGAVGVFAHEYGHDLGLPDEYDTQYSGHGEPVQAWSIMSGGSWAGKIAGTTPTSFSPQNKEFF QKTIGGNWANIVEVDYEKLNKGIGLATYLDQSVTKTNRPGMIRVNLPDKDIKTIDPAFGKQYYYSTKGDDLHTKLETPLF DLTNATTAKFDFKSLYEIEAEYDFLEVHAVTEDGQQTLIERLGEKANNGNADSTNGKWIDKSYDLSQFKGKKVKLTFDYI TDGGLALNGFLLDNASLTVDGKVVFSDDAEGTPQFKLDGFAVSNGTEKKSHNYYVEWRNYAGSDNALKFARGPEYNTGMV VWYADSAYTDNWVGVHPGHGFLGVVDSHPEAIVGTLNGKPTVESSTRFQIADAAFSFDKTPAWKVVSPTRGTYTYNGLAG VPKFDDSKTYINQQIPDAGRILPNLGLKFEVVGQADDNSAGAVRLYR >Mature_687_residues MKDAKADTKEKLDKPATGTPAATGPVRGGLNGKVPTSPAKQKAYNGDVRKDKVLVLLVEYADFKHNNIDKEPGYMYSEDF NKEHYEKMLFGDEPFTLDDGSKIETFKQYYEEQSGGSYTVDGTVTKWLTVPGKAADYGADAATGHDNKGPKGPRDLVKDA LKAAVDSGLDLSEFDQFDQYDVNGDGNKNQPDGLIDHLMIIHAGVGQEAGGGKLGDDAIWSHRWTVGPKPFPIEGTQAKV PYWGGKMAAFDYTIEPEDGAVGVFAHEYGHDLGLPDEYDTQYSGHGEPVQAWSIMSGGSWAGKIAGTTPTSFSPQNKEFF QKTIGGNWANIVEVDYEKLNKGIGLATYLDQSVTKTNRPGMIRVNLPDKDIKTIDPAFGKQYYYSTKGDDLHTKLETPLF DLTNATTAKFDFKSLYEIEAEYDFLEVHAVTEDGQQTLIERLGEKANNGNADSTNGKWIDKSYDLSQFKGKKVKLTFDYI TDGGLALNGFLLDNASLTVDGKVVFSDDAEGTPQFKLDGFAVSNGTEKKSHNYYVEWRNYAGSDNALKFARGPEYNTGMV VWYADSAYTDNWVGVHPGHGFLGVVDSHPEAIVGTLNGKPTVESSTRFQIADAAFSFDKTPAWKVVSPTRGTYTYNGLAG VPKFDDSKTYINQQIPDAGRILPNLGLKFEVVGQADDNSAGAVRLYR
Specific function: Neutral metalloprotease that is secreted to degrade antibacterial proteins produced by the insect host for its defense (attacins and cecropins). Probably degrades some unknown crucial protein(s) too, since it is toxic when injected to insect larvae [H]
COG id: COG4412
COG function: function code S; Uncharacterized protein conserved in bacteria
Gene ontology:
Cell location: Secreted [H]
Metaboloic importance: NA
Operon status: Not Known
Operon components: None
Similarity: Belongs to the peptidase M6 family [H]
Homologues:
None
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR012300 - InterPro: IPR008757 [H]
Pfam domain/function: PF05547 Peptidase_M6 [H]
EC number: NA
Molecular weight: Translated: 75246; Mature: 75246
Theoretical pI: Translated: 4.80; Mature: 4.80
Prosite motif: PS00142 ZINC_PROTEASE
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.0 %Cys (Translated Protein) 1.2 %Met (Translated Protein) 1.2 %Cys+Met (Translated Protein) 0.0 %Cys (Mature Protein) 1.2 %Met (Mature Protein) 1.2 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MKDAKADTKEKLDKPATGTPAATGPVRGGLNGKVPTSPAKQKAYNGDVRKDKVLVLLVEY CCCCCCCHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHCCCCCCCCCEEEEEEEEE ADFKHNNIDKEPGYMYSEDFNKEHYEKMLFGDEPFTLDDGSKIETFKQYYEEQSGGSYTV CCCCCCCCCCCCCCCCCCCCCHHHHHHHHCCCCCEECCCCCHHHHHHHHHHHCCCCCEEE DGTVTKWLTVPGKAADYGADAATGHDNKGPKGPRDLVKDALKAAVDSGLDLSEFDQFDQY CCEEEEEEECCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHCCCCHHHHHCCCCE DVNGDGNKNQPDGLIDHLMIIHAGVGQEAGGGKLGDDAIWSHRWTVGPKPFPIEGTQAKV ECCCCCCCCCCHHHHHHHHHEECCCCCCCCCCCCCCCCCCCCEEECCCCCCCCCCCCEEC PYWGGKMAAFDYTIEPEDGAVGVFAHEYGHDLGLPDEYDTQYSGHGEPVQAWSIMSGGSW CCCCCEEEEEEEEECCCCCEEEEEEHHCCCCCCCCCCCCCCCCCCCCCEEEEEEECCCCC AGKIAGTTPTSFSPQNKEFFQKTIGGNWANIVEVDYEKLNKGIGLATYLDQSVTKTNRPG CCEECCCCCCCCCCCCHHHHHHHHCCCEEEEEEECHHHHCCCCCCHHHHHHHHHCCCCCC MIRVNLPDKDIKTIDPAFGKQYYYSTKGDDLHTKLETPLFDLTNATTAKFDFKSLYEIEA EEEEECCCCCCCCCCHHHCCCEEEECCCCCCCCCCCCCEEECCCCCEEEECHHHHEEEEC EYDFLEVHAVTEDGQQTLIERLGEKANNGNADSTNGKWIDKSYDLSQFKGKKVKLTFDYI CCCEEEEEEECCCHHHHHHHHHHHCCCCCCCCCCCCEEECCCCCHHHCCCCEEEEEEEEE TDGGLALNGFLLDNASLTVDGKVVFSDDAEGTPQFKLDGFAVSNGTEKKSHNYYVEWRNY CCCCEEEEEEEEECCEEEECCEEEECCCCCCCCCEEECCEEECCCCCCCCCCEEEEEECC AGSDNALKFARGPEYNTGMVVWYADSAYTDNWVGVHPGHGFLGVVDSHPEAIVGTLNGKP CCCCCCEEECCCCCCCCCEEEEEECCCCCCCEEEECCCCCEEEEECCCCCEEEEECCCCC TVESSTRFQIADAAFSFDKTPAWKVVSPTRGTYTYNGLAGVPKFDDSKTYINQQIPDAGR CCCCCCEEEEEHHEECCCCCCCEEEECCCCCCEEECCCCCCCCCCCCHHHHHHCCCCHHH ILPNLGLKFEVVGQADDNSAGAVRLYR HHCCCCCEEEEEECCCCCCCCEEEEEC >Mature Secondary Structure MKDAKADTKEKLDKPATGTPAATGPVRGGLNGKVPTSPAKQKAYNGDVRKDKVLVLLVEY CCCCCCCHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHCCCCCCCCCEEEEEEEEE ADFKHNNIDKEPGYMYSEDFNKEHYEKMLFGDEPFTLDDGSKIETFKQYYEEQSGGSYTV CCCCCCCCCCCCCCCCCCCCCHHHHHHHHCCCCCEECCCCCHHHHHHHHHHHCCCCCEEE DGTVTKWLTVPGKAADYGADAATGHDNKGPKGPRDLVKDALKAAVDSGLDLSEFDQFDQY CCEEEEEEECCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHCCCCHHHHHCCCCE DVNGDGNKNQPDGLIDHLMIIHAGVGQEAGGGKLGDDAIWSHRWTVGPKPFPIEGTQAKV ECCCCCCCCCCHHHHHHHHHEECCCCCCCCCCCCCCCCCCCCEEECCCCCCCCCCCCEEC PYWGGKMAAFDYTIEPEDGAVGVFAHEYGHDLGLPDEYDTQYSGHGEPVQAWSIMSGGSW CCCCCEEEEEEEEECCCCCEEEEEEHHCCCCCCCCCCCCCCCCCCCCCEEEEEEECCCCC AGKIAGTTPTSFSPQNKEFFQKTIGGNWANIVEVDYEKLNKGIGLATYLDQSVTKTNRPG CCEECCCCCCCCCCCCHHHHHHHHCCCEEEEEEECHHHHCCCCCCHHHHHHHHHCCCCCC MIRVNLPDKDIKTIDPAFGKQYYYSTKGDDLHTKLETPLFDLTNATTAKFDFKSLYEIEA EEEEECCCCCCCCCCHHHCCCEEEECCCCCCCCCCCCCEEECCCCCEEEECHHHHEEEEC EYDFLEVHAVTEDGQQTLIERLGEKANNGNADSTNGKWIDKSYDLSQFKGKKVKLTFDYI CCCEEEEEEECCCHHHHHHHHHHHCCCCCCCCCCCCEEECCCCCHHHCCCCEEEEEEEEE TDGGLALNGFLLDNASLTVDGKVVFSDDAEGTPQFKLDGFAVSNGTEKKSHNYYVEWRNY CCCCEEEEEEEEECCEEEECCEEEECCCCCCCCCEEECCEEECCCCCCCCCCEEEEEECC AGSDNALKFARGPEYNTGMVVWYADSAYTDNWVGVHPGHGFLGVVDSHPEAIVGTLNGKP CCCCCCEEECCCCCCCCCEEEEEECCCCCCCEEEECCCCCEEEEECCCCCEEEEECCCCC TVESSTRFQIADAAFSFDKTPAWKVVSPTRGTYTYNGLAGVPKFDDSKTYINQQIPDAGR CCCCCCEEEEEHHEECCCCCCCEEEECCCCCCEEECCCCCCCCCCCCHHHHHHCCCCHHH ILPNLGLKFEVVGQADDNSAGAVRLYR HHCCCCCEEEEEECCCCCCCCEEEEEC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 2089225; 6421577 [H]