Definition Bacillus anthracis str. Sterne chromosome, complete genome.
Accession NC_005945
Length 5,228,663

Click here to switch to the map view.

The map label for this gene is ina [H]

Identifier: 49184215

GI number: 49184215

Start: 1240387

End: 1242774

Strand: Direct

Name: ina [H]

Synonym: BAS1197

Alternate gene names: 49184215

Gene position: 1240387-1242774 (Clockwise)

Preceding gene: 49184212

Following gene: 49184216

Centisome position: 23.72

GC content: 39.07

Gene sequence:

>2388_bases
ATGAACAAGAAACCGTTCAAAGTTTTATCATCAATCGCTTTGACAGCTGTATTAGGCCTTTCATTCGGAGCGGGTGGCCA
GTCTGTATATGCTGAAACGCCTGTGAATAAGACAGCTACGAGTCCAGTTGATGATCATTTAATTCCGGAAGAACGTTTAG
CAGATGCGCTAAAAAAACGTGGGGTAATTGATTCGAAGGCTTCAGAGAAAGAAACAAAGAAAGCTGTCGAAAAATATGTA
GAGAATAAAAAGGGTGAAAATCCTGGGAAAGAAGTAACAAATGGGGACCCACTTACGAAAGAAGCATCTGACTTTGTAAA
GAAAGTGAAAGATGCGAAAGCAGATACGAAAGAAAAGTTAGATAAACCTGCAACAGGAACACCTGCAGCGACAGGACCAG
TTAGAGGTGGTCTAAATGGTAAAGTACCAACATCTCCAGCGAAGCAAAAAGCGTACAATGGTGATGTACGTAAAGATAAA
GTACTTGTTTTACTTGTAGAGTACGCTGACTTTAAACATAACAATATTGATAAAGAGCCTGGTTATATGTATTCGGAAGA
CTTTAACAAAGAACATTATGAAAAAATGTTATTCGGTGACGAGCCATTCACATTAGATGATGGAAGTAAAATCGAAACGT
TTAAACAATATTACGAAGAGCAATCTGGTGGTAGTTATACAGTAGATGGAACAGTTACAAAATGGTTAACAGTTCCTGGT
AAAGCTGCTGATTACGGTGCAGATGCTGCTACTGGTCATGATAATAAAGGACCAAAAGGACCACGTGATTTAGTAAAAGA
TGCATTAAAAGCTGCTGTAGATAGCGGTCTTGATTTATCAGAATTTGATCAATTTGACCAATATGATGTAAATGGTGATG
GAAATAAAAATCAACCAGATGGTTTAATTGACCACTTAATGATTATTCATGCAGGAGTTGGACAAGAAGCTGGTGGTGGT
AAATTAGGTGACGATGCAATTTGGTCACATCGCTGGACAGTTGGACCAAAACCATTCCCAATTGAAGGCACGCAAGCGAA
AGTTCCATATTGGGGTGGAAAGATGGCAGCGTTTGACTACACAATTGAACCAGAAGATGGCGCGGTCGGTGTATTCGCAC
ATGAATATGGTCATGATTTAGGTTTACCAGATGAGTATGATACACAATATAGCGGTCATGGTGAACCAGTTCAAGCTTGG
TCTATTATGAGCGGCGGAAGCTGGGCAGGTAAAATCGCCGGAACGACGCCAACAAGTTTCTCACCACAAAATAAAGAGTT
TTTCCAAAAAACAATTGGTGGTAACTGGGCAAATATCGTAGAAGTAGATTACGAGAAATTAAATAAAGGTATCGGTCTAG
CAACATATTTAGACCAAAGTGTTACAAAAACGAACCGTCCAGGTATGATTCGTGTTAACTTACCGGATAAAGATATAAAA
ACAATTGATCCAGCATTCGGAAAACAGTATTACTACAGTACAAAAGGTGACGATCTTCATACGAAGTTGGAAACACCACT
GTTCGATTTAACGAATGCAACGACTGCGAAATTTGATTTTAAATCATTATATGAAATTGAAGCAGAGTATGACTTCCTTG
AAGTACACGCTGTAACAGAAGATGGTCAACAAACGTTAATCGAAAGACTTGGTGAGAAAGCAAATAATGGAAATGCAGAT
TCGACAAATGGAAAATGGATTGATAAATCATATGATTTAAGCCAATTCAAAGGTAAGAAAGTAAAATTAACATTTGATTA
CATTACTGATGGTGGTTTAGCATTAAACGGTTTCCTACTTGATAATGCTTCATTAACAGTAGATGGTAAAGTAGTATTCT
CTGATGATGCAGAAGGGACACCACAATTCAAATTAGATGGTTTTGCTGTTTCTAACGGAACAGAGAAGAAGAGCCATAAC
TACTATGTTGAGTGGAGAAACTATGCTGGTTCTGATAACGCATTGAAATTTGCTCGCGGCCCAGAATATAACACTGGTAT
GGTTGTATGGTATGCAGATTCAGCTTACACAGATAACTGGGTTGGTGTACATCCAGGACACGGTTTCCTTGGTGTAGTCG
ATTCTCACCCAGAAGCAATTGTAGGAACTTTAAATGGTAAGCCGACAGTTGAAAGTAGTACACGATTCCAAATCGCTGAT
GCGGCGTTCTCATTCGATAAAACGCCAGCTTGGAAAGTTGTATCTCCAACGCGTGGAACGTATACGTATAATGGCTTAGC
GGGTGTACCGAAGTTTGATGATTCGAAAACGTATATTAATCAACAGATTCCAGATGCAGGACGTATTTTACCAAATCTTG
GCCTGAAGTTTGAAGTAGTAGGACAAGCTGATGATAATTCTGCAGGTGCTGTTCGCTTATATCGCTAA

Upstream 100 bases:

>100_bases
TAAAAACATTACATAATATGACTAAATATTGAAAAAATATTGAATTTTTAATAAAATTCAATTTGTAATACATATTATTT
ATTAGGGGAGGAAATAAGGG

Downstream 100 bases:

>100_bases
TACAGTAAAACTACCGAAAGATTCTCTTTCGGTAGTTTTTTTGTGAGCAATGAATTTTATATAAAAGAAGAAATTATATA
TAATGTAACTTTACGAATGA

Product: immune inhibitor A metalloprotease

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 795; Mature: 795

Protein sequence:

>795_residues
MNKKPFKVLSSIALTAVLGLSFGAGGQSVYAETPVNKTATSPVDDHLIPEERLADALKKRGVIDSKASEKETKKAVEKYV
ENKKGENPGKEVTNGDPLTKEASDFVKKVKDAKADTKEKLDKPATGTPAATGPVRGGLNGKVPTSPAKQKAYNGDVRKDK
VLVLLVEYADFKHNNIDKEPGYMYSEDFNKEHYEKMLFGDEPFTLDDGSKIETFKQYYEEQSGGSYTVDGTVTKWLTVPG
KAADYGADAATGHDNKGPKGPRDLVKDALKAAVDSGLDLSEFDQFDQYDVNGDGNKNQPDGLIDHLMIIHAGVGQEAGGG
KLGDDAIWSHRWTVGPKPFPIEGTQAKVPYWGGKMAAFDYTIEPEDGAVGVFAHEYGHDLGLPDEYDTQYSGHGEPVQAW
SIMSGGSWAGKIAGTTPTSFSPQNKEFFQKTIGGNWANIVEVDYEKLNKGIGLATYLDQSVTKTNRPGMIRVNLPDKDIK
TIDPAFGKQYYYSTKGDDLHTKLETPLFDLTNATTAKFDFKSLYEIEAEYDFLEVHAVTEDGQQTLIERLGEKANNGNAD
STNGKWIDKSYDLSQFKGKKVKLTFDYITDGGLALNGFLLDNASLTVDGKVVFSDDAEGTPQFKLDGFAVSNGTEKKSHN
YYVEWRNYAGSDNALKFARGPEYNTGMVVWYADSAYTDNWVGVHPGHGFLGVVDSHPEAIVGTLNGKPTVESSTRFQIAD
AAFSFDKTPAWKVVSPTRGTYTYNGLAGVPKFDDSKTYINQQIPDAGRILPNLGLKFEVVGQADDNSAGAVRLYR

Sequences:

>Translated_795_residues
MNKKPFKVLSSIALTAVLGLSFGAGGQSVYAETPVNKTATSPVDDHLIPEERLADALKKRGVIDSKASEKETKKAVEKYV
ENKKGENPGKEVTNGDPLTKEASDFVKKVKDAKADTKEKLDKPATGTPAATGPVRGGLNGKVPTSPAKQKAYNGDVRKDK
VLVLLVEYADFKHNNIDKEPGYMYSEDFNKEHYEKMLFGDEPFTLDDGSKIETFKQYYEEQSGGSYTVDGTVTKWLTVPG
KAADYGADAATGHDNKGPKGPRDLVKDALKAAVDSGLDLSEFDQFDQYDVNGDGNKNQPDGLIDHLMIIHAGVGQEAGGG
KLGDDAIWSHRWTVGPKPFPIEGTQAKVPYWGGKMAAFDYTIEPEDGAVGVFAHEYGHDLGLPDEYDTQYSGHGEPVQAW
SIMSGGSWAGKIAGTTPTSFSPQNKEFFQKTIGGNWANIVEVDYEKLNKGIGLATYLDQSVTKTNRPGMIRVNLPDKDIK
TIDPAFGKQYYYSTKGDDLHTKLETPLFDLTNATTAKFDFKSLYEIEAEYDFLEVHAVTEDGQQTLIERLGEKANNGNAD
STNGKWIDKSYDLSQFKGKKVKLTFDYITDGGLALNGFLLDNASLTVDGKVVFSDDAEGTPQFKLDGFAVSNGTEKKSHN
YYVEWRNYAGSDNALKFARGPEYNTGMVVWYADSAYTDNWVGVHPGHGFLGVVDSHPEAIVGTLNGKPTVESSTRFQIAD
AAFSFDKTPAWKVVSPTRGTYTYNGLAGVPKFDDSKTYINQQIPDAGRILPNLGLKFEVVGQADDNSAGAVRLYR
>Mature_795_residues
MNKKPFKVLSSIALTAVLGLSFGAGGQSVYAETPVNKTATSPVDDHLIPEERLADALKKRGVIDSKASEKETKKAVEKYV
ENKKGENPGKEVTNGDPLTKEASDFVKKVKDAKADTKEKLDKPATGTPAATGPVRGGLNGKVPTSPAKQKAYNGDVRKDK
VLVLLVEYADFKHNNIDKEPGYMYSEDFNKEHYEKMLFGDEPFTLDDGSKIETFKQYYEEQSGGSYTVDGTVTKWLTVPG
KAADYGADAATGHDNKGPKGPRDLVKDALKAAVDSGLDLSEFDQFDQYDVNGDGNKNQPDGLIDHLMIIHAGVGQEAGGG
KLGDDAIWSHRWTVGPKPFPIEGTQAKVPYWGGKMAAFDYTIEPEDGAVGVFAHEYGHDLGLPDEYDTQYSGHGEPVQAW
SIMSGGSWAGKIAGTTPTSFSPQNKEFFQKTIGGNWANIVEVDYEKLNKGIGLATYLDQSVTKTNRPGMIRVNLPDKDIK
TIDPAFGKQYYYSTKGDDLHTKLETPLFDLTNATTAKFDFKSLYEIEAEYDFLEVHAVTEDGQQTLIERLGEKANNGNAD
STNGKWIDKSYDLSQFKGKKVKLTFDYITDGGLALNGFLLDNASLTVDGKVVFSDDAEGTPQFKLDGFAVSNGTEKKSHN
YYVEWRNYAGSDNALKFARGPEYNTGMVVWYADSAYTDNWVGVHPGHGFLGVVDSHPEAIVGTLNGKPTVESSTRFQIAD
AAFSFDKTPAWKVVSPTRGTYTYNGLAGVPKFDDSKTYINQQIPDAGRILPNLGLKFEVVGQADDNSAGAVRLYR

Specific function: Neutral metalloprotease that is secreted to degrade antibacterial proteins produced by the insect host for its defense (attacins and cecropins). Probably degrades some unknown crucial protein(s) too, since it is toxic when injected to insect larvae [H]

COG id: COG4412

COG function: function code S; Uncharacterized protein conserved in bacteria

Gene ontology:

Cell location: Secreted [H]

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Belongs to the peptidase M6 family [H]

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR012300
- InterPro:   IPR008757 [H]

Pfam domain/function: PF05547 Peptidase_M6 [H]

EC number: NA

Molecular weight: Translated: 86812; Mature: 86812

Theoretical pI: Translated: 5.04; Mature: 5.04

Prosite motif: PS00142 ZINC_PROTEASE

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.0 %Cys     (Translated Protein)
1.0 %Met     (Translated Protein)
1.0 %Cys+Met (Translated Protein)
0.0 %Cys     (Mature Protein)
1.0 %Met     (Mature Protein)
1.0 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MNKKPFKVLSSIALTAVLGLSFGAGGQSVYAETPVNKTATSPVDDHLIPEERLADALKKR
CCCCHHHHHHHHHHHHHHHHCCCCCCCEEEEECCCCCCCCCCCCCCCCCHHHHHHHHHHC
GVIDSKASEKETKKAVEKYVENKKGENPGKEVTNGDPLTKEASDFVKKVKDAKADTKEKL
CCCCCCCHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCHHHHHHHHHHHHCCCCHHHHH
DKPATGTPAATGPVRGGLNGKVPTSPAKQKAYNGDVRKDKVLVLLVEYADFKHNNIDKEP
CCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHCCCCCCCCEEEEEEEEECCCCCCCCCCCC
GYMYSEDFNKEHYEKMLFGDEPFTLDDGSKIETFKQYYEEQSGGSYTVDGTVTKWLTVPG
CCCCCCCCCHHHHHHHHCCCCCEECCCCCHHHHHHHHHHHCCCCCEEECCCEEEEEECCC
KAADYGADAATGHDNKGPKGPRDLVKDALKAAVDSGLDLSEFDQFDQYDVNGDGNKNQPD
CCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHCCCCHHHHHCCCCCCCCCCCCCCCCH
GLIDHLMIIHAGVGQEAGGGKLGDDAIWSHRWTVGPKPFPIEGTQAKVPYWGGKMAAFDY
HHHHHHHHHCCCCCCCCCCCCCCCCCHHCCEECCCCCCCCCCCCCEECCCCCCEEEEEEE
TIEPEDGAVGVFAHEYGHDLGLPDEYDTQYSGHGEPVQAWSIMSGGSWAGKIAGTTPTSF
EECCCCCEEEEEEHHCCCCCCCCCCCCCCCCCCCCCEEEEEEECCCCCCCEECCCCCCCC
SPQNKEFFQKTIGGNWANIVEVDYEKLNKGIGLATYLDQSVTKTNRPGMIRVNLPDKDIK
CCCCHHHHHHHHCCCEEEEEEECHHHHHCCCCCHHHHHHHHHCCCCCCEEEEECCCCCCC
TIDPAFGKQYYYSTKGDDLHTKLETPLFDLTNATTAKFDFKSLYEIEAEYDFLEVHAVTE
CCCHHHCCCEEEECCCCCCHHHHCCCEEECCCCCEEEECHHHHHEECCCCCEEEEEEECC
DGQQTLIERLGEKANNGNADSTNGKWIDKSYDLSQFKGKKVKLTFDYITDGGLALNGFLL
CHHHHHHHHHHHCCCCCCCCCCCCCEECCCCCHHHHCCCEEEEEEEEECCCCEEEEEEEE
DNASLTVDGKVVFSDDAEGTPQFKLDGFAVSNGTEKKSHNYYVEWRNYAGSDNALKFARG
ECCEEEECCEEEECCCCCCCCCEEECCEEECCCCCCCCCCEEEEEECCCCCCCCEEECCC
PEYNTGMVVWYADSAYTDNWVGVHPGHGFLGVVDSHPEAIVGTLNGKPTVESSTRFQIAD
CCCCCCEEEEEECCCCCCCEEEECCCCCEEEEECCCCCEEEECCCCCCCCCCCCEEEEEH
AAFSFDKTPAWKVVSPTRGTYTYNGLAGVPKFDDSKTYINQQIPDAGRILPNLGLKFEVV
HHHCCCCCCCEEEECCCCCCEEECCCCCCCCCCCCHHHHHHCCCCHHHHHCCCCCEEEEE
GQADDNSAGAVRLYR
ECCCCCCCCEEEEEC
>Mature Secondary Structure
MNKKPFKVLSSIALTAVLGLSFGAGGQSVYAETPVNKTATSPVDDHLIPEERLADALKKR
CCCCHHHHHHHHHHHHHHHHCCCCCCCEEEEECCCCCCCCCCCCCCCCCHHHHHHHHHHC
GVIDSKASEKETKKAVEKYVENKKGENPGKEVTNGDPLTKEASDFVKKVKDAKADTKEKL
CCCCCCCHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCHHHHHHHHHHHHCCCCHHHHH
DKPATGTPAATGPVRGGLNGKVPTSPAKQKAYNGDVRKDKVLVLLVEYADFKHNNIDKEP
CCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHCCCCCCCCEEEEEEEEECCCCCCCCCCCC
GYMYSEDFNKEHYEKMLFGDEPFTLDDGSKIETFKQYYEEQSGGSYTVDGTVTKWLTVPG
CCCCCCCCCHHHHHHHHCCCCCEECCCCCHHHHHHHHHHHCCCCCEEECCCEEEEEECCC
KAADYGADAATGHDNKGPKGPRDLVKDALKAAVDSGLDLSEFDQFDQYDVNGDGNKNQPD
CCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHCCCCHHHHHCCCCCCCCCCCCCCCCH
GLIDHLMIIHAGVGQEAGGGKLGDDAIWSHRWTVGPKPFPIEGTQAKVPYWGGKMAAFDY
HHHHHHHHHCCCCCCCCCCCCCCCCCHHCCEECCCCCCCCCCCCCEECCCCCCEEEEEEE
TIEPEDGAVGVFAHEYGHDLGLPDEYDTQYSGHGEPVQAWSIMSGGSWAGKIAGTTPTSF
EECCCCCEEEEEEHHCCCCCCCCCCCCCCCCCCCCCEEEEEEECCCCCCCEECCCCCCCC
SPQNKEFFQKTIGGNWANIVEVDYEKLNKGIGLATYLDQSVTKTNRPGMIRVNLPDKDIK
CCCCHHHHHHHHCCCEEEEEEECHHHHHCCCCCHHHHHHHHHCCCCCCEEEEECCCCCCC
TIDPAFGKQYYYSTKGDDLHTKLETPLFDLTNATTAKFDFKSLYEIEAEYDFLEVHAVTE
CCCHHHCCCEEEECCCCCCHHHHCCCEEECCCCCEEEECHHHHHEECCCCCEEEEEEECC
DGQQTLIERLGEKANNGNADSTNGKWIDKSYDLSQFKGKKVKLTFDYITDGGLALNGFLL
CHHHHHHHHHHHCCCCCCCCCCCCCEECCCCCHHHHCCCEEEEEEEEECCCCEEEEEEEE
DNASLTVDGKVVFSDDAEGTPQFKLDGFAVSNGTEKKSHNYYVEWRNYAGSDNALKFARG
ECCEEEECCEEEECCCCCCCCCEEECCEEECCCCCCCCCCEEEEEECCCCCCCCEEECCC
PEYNTGMVVWYADSAYTDNWVGVHPGHGFLGVVDSHPEAIVGTLNGKPTVESSTRFQIAD
CCCCCCEEEEEECCCCCCCEEEECCCCCEEEEECCCCCEEEECCCCCCCCCCCCEEEEEH
AAFSFDKTPAWKVVSPTRGTYTYNGLAGVPKFDDSKTYINQQIPDAGRILPNLGLKFEVV
HHHCCCCCCCEEEECCCCCCEEECCCCCCCCCCCCHHHHHHCCCCHHHHHCCCCCEEEEE
GQADDNSAGAVRLYR
ECCCCCCCCEEEEEC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 2089225; 6421577 [H]