Definition Bacillus anthracis str. CDC 684, complete genome.
Accession NC_012581
Length 5,230,115

Click here to switch to the map view.

The map label for this gene is ina [H]

Identifier: 227815876

GI number: 227815876

Start: 2996368

End: 2998431

Strand: Reverse

Name: ina [H]

Synonym: BAMEG_3301

Alternate gene names: 227815876

Gene position: 2998431-2996368 (Counterclockwise)

Preceding gene: 227815877

Following gene: 227815875

Centisome position: 57.33

GC content: 38.91

Gene sequence:

>2064_bases
GTGAAAGATGCGAAAGCAGATACGAAAGAAAAGTTAGATAAACCTGCAACAGGAACACCTGCAGCGACAGGACCAGTTAG
AGGTGGTCTAAATGGTAAAGTACCAACATCTCCAGCGAAGCAAAAAGCGTACAATGGTGATGTACGTAAAGATAAAGTAC
TTGTTTTACTTGTAGAGTACGCTGACTTTAAACATAACAATATTGATAAAGAGCCTGGTTATATGTATTCGGAAGACTTT
AACAAAGAACATTATGAAAAAATGTTATTCGGTGACGAGCCATTCACATTAGATGATGGAAGTAAAATCGAAACGTTTAA
ACAATATTACGAAGAGCAATCTGGTGGTAGTTATACAGTAGATGGAACAGTTACAAAATGGTTAACAGTTCCTGGTAAAG
CTGCTGATTACGGTGCAGATGCTGCTACTGGTCATGATAATAAAGGACCAAAAGGACCACGTGATTTAGTAAAAGATGCA
TTAAAAGCTGCTGTAGATAGCGGTCTTGATTTATCAGAATTTGATCAATTTGACCAATATGATGTAAATGGTGATGGAAA
TAAAAATCAACCAGATGGTTTAATTGACCACTTAATGATTATTCATGCAGGAGTTGGACAAGAAGCTGGTGGTGGTAAAT
TAGGTGACGATGCAATTTGGTCACATCGCTGGACAGTTGGACCAAAACCATTCCCAATTGAAGGCACGCAAGCGAAAGTT
CCATATTGGGGTGGAAAGATGGCAGCGTTTGACTACACAATTGAACCAGAAGATGGCGCGGTCGGTGTATTCGCACATGA
ATATGGTCATGATTTAGGTTTACCAGATGAGTATGATACACAATATAGCGGTCATGGTGAACCAGTTCAAGCTTGGTCTA
TTATGAGCGGCGGAAGCTGGGCAGGTAAAATCGCCGGAACGACGCCAACAAGTTTCTCACCACAAAATAAAGAGTTTTTC
CAAAAAACAATTGGTGGTAACTGGGCAAATATCGTAGAAGTAGATTACGAGAAATTAAATAAAGGTATCGGTCTAGCAAC
ATATTTAGACCAAAGTGTTACAAAAACGAACCGTCCAGGTATGATTCGTGTTAACTTACCGGATAAAGATATAAAAACAA
TTGATCCAGCATTCGGAAAACAGTATTACTACAGTACAAAAGGTGACGATCTTCATACGAAGTTGGAAACACCACTGTTC
GATTTAACGAATGCAACGACTGCGAAATTTGATTTTAAATCATTATATGAAATTGAAGCAGAGTATGACTTCCTTGAAGT
ACACGCTGTAACAGAAGATGGTCAACAAACGTTAATCGAAAGACTTGGTGAGAAAGCAAATAATGGAAATGCAGATTCGA
CAAATGGAAAATGGATTGATAAATCATATGATTTAAGCCAATTCAAAGGTAAGAAAGTAAAATTAACATTTGATTACATT
ACTGATGGTGGTTTAGCATTAAACGGTTTCCTACTTGATAATGCTTCATTAACAGTAGATGGTAAAGTAGTATTCTCTGA
TGATGCAGAAGGGACACCACAATTCAAATTAGATGGTTTTGCTGTTTCTAACGGAACAGAGAAGAAGAGCCATAACTACT
ATGTTGAGTGGAGAAACTATGCTGGTTCTGATAACGCATTGAAATTTGCTCGCGGCCCAGAATATAACACTGGTATGGTT
GTATGGTATGCAGATTCAGCTTACACAGATAACTGGGTTGGTGTACATCCAGGACACGGTTTCCTTGGTGTAGTCGATTC
TCACCCAGAAGCAATTGTAGGAACTTTAAATGGTAAGCCGACAGTTGAAAGTAGTACACGATTCCAAATCGCTGATGCGG
CGTTCTCATTCGATAAAACGCCAGCTTGGAAAGTTGTATCTCCAACGCGTGGAACGTATACGTATAATGGCTTAGCGGGT
GTACCGAAGTTTGATGATTCGAAAACGTATATTAATCAACAGATTCCAGATGCAGGACGTATTTTACCAAATCTTGGCCT
GAAGTTTGAAGTAGTAGGACAAGCTGATGATAATTCTGCAGGTGCTGTTCGCTTATATCGCTAA

Upstream 100 bases:

>100_bases
TGTCGAAAAATATGTAGAGAATAAAAAGGGTGAAAATCCTGGGAAAGAAGTAACAAATGGGGACCCACTTACGAAAGAAG
CATCTGACTTTGTAAAGAAA

Downstream 100 bases:

>100_bases
TACAGTAAAACTACCGAAAGATTCTCTTTCGGTAGTTTTTTTGTGAGCAATGAATTTTATATAAAAGAAGAAATTATATA
TAATGTAACTTTACGAATGA

Product: immune inhibitor A

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 687; Mature: 687

Protein sequence:

>687_residues
MKDAKADTKEKLDKPATGTPAATGPVRGGLNGKVPTSPAKQKAYNGDVRKDKVLVLLVEYADFKHNNIDKEPGYMYSEDF
NKEHYEKMLFGDEPFTLDDGSKIETFKQYYEEQSGGSYTVDGTVTKWLTVPGKAADYGADAATGHDNKGPKGPRDLVKDA
LKAAVDSGLDLSEFDQFDQYDVNGDGNKNQPDGLIDHLMIIHAGVGQEAGGGKLGDDAIWSHRWTVGPKPFPIEGTQAKV
PYWGGKMAAFDYTIEPEDGAVGVFAHEYGHDLGLPDEYDTQYSGHGEPVQAWSIMSGGSWAGKIAGTTPTSFSPQNKEFF
QKTIGGNWANIVEVDYEKLNKGIGLATYLDQSVTKTNRPGMIRVNLPDKDIKTIDPAFGKQYYYSTKGDDLHTKLETPLF
DLTNATTAKFDFKSLYEIEAEYDFLEVHAVTEDGQQTLIERLGEKANNGNADSTNGKWIDKSYDLSQFKGKKVKLTFDYI
TDGGLALNGFLLDNASLTVDGKVVFSDDAEGTPQFKLDGFAVSNGTEKKSHNYYVEWRNYAGSDNALKFARGPEYNTGMV
VWYADSAYTDNWVGVHPGHGFLGVVDSHPEAIVGTLNGKPTVESSTRFQIADAAFSFDKTPAWKVVSPTRGTYTYNGLAG
VPKFDDSKTYINQQIPDAGRILPNLGLKFEVVGQADDNSAGAVRLYR

Sequences:

>Translated_687_residues
MKDAKADTKEKLDKPATGTPAATGPVRGGLNGKVPTSPAKQKAYNGDVRKDKVLVLLVEYADFKHNNIDKEPGYMYSEDF
NKEHYEKMLFGDEPFTLDDGSKIETFKQYYEEQSGGSYTVDGTVTKWLTVPGKAADYGADAATGHDNKGPKGPRDLVKDA
LKAAVDSGLDLSEFDQFDQYDVNGDGNKNQPDGLIDHLMIIHAGVGQEAGGGKLGDDAIWSHRWTVGPKPFPIEGTQAKV
PYWGGKMAAFDYTIEPEDGAVGVFAHEYGHDLGLPDEYDTQYSGHGEPVQAWSIMSGGSWAGKIAGTTPTSFSPQNKEFF
QKTIGGNWANIVEVDYEKLNKGIGLATYLDQSVTKTNRPGMIRVNLPDKDIKTIDPAFGKQYYYSTKGDDLHTKLETPLF
DLTNATTAKFDFKSLYEIEAEYDFLEVHAVTEDGQQTLIERLGEKANNGNADSTNGKWIDKSYDLSQFKGKKVKLTFDYI
TDGGLALNGFLLDNASLTVDGKVVFSDDAEGTPQFKLDGFAVSNGTEKKSHNYYVEWRNYAGSDNALKFARGPEYNTGMV
VWYADSAYTDNWVGVHPGHGFLGVVDSHPEAIVGTLNGKPTVESSTRFQIADAAFSFDKTPAWKVVSPTRGTYTYNGLAG
VPKFDDSKTYINQQIPDAGRILPNLGLKFEVVGQADDNSAGAVRLYR
>Mature_687_residues
MKDAKADTKEKLDKPATGTPAATGPVRGGLNGKVPTSPAKQKAYNGDVRKDKVLVLLVEYADFKHNNIDKEPGYMYSEDF
NKEHYEKMLFGDEPFTLDDGSKIETFKQYYEEQSGGSYTVDGTVTKWLTVPGKAADYGADAATGHDNKGPKGPRDLVKDA
LKAAVDSGLDLSEFDQFDQYDVNGDGNKNQPDGLIDHLMIIHAGVGQEAGGGKLGDDAIWSHRWTVGPKPFPIEGTQAKV
PYWGGKMAAFDYTIEPEDGAVGVFAHEYGHDLGLPDEYDTQYSGHGEPVQAWSIMSGGSWAGKIAGTTPTSFSPQNKEFF
QKTIGGNWANIVEVDYEKLNKGIGLATYLDQSVTKTNRPGMIRVNLPDKDIKTIDPAFGKQYYYSTKGDDLHTKLETPLF
DLTNATTAKFDFKSLYEIEAEYDFLEVHAVTEDGQQTLIERLGEKANNGNADSTNGKWIDKSYDLSQFKGKKVKLTFDYI
TDGGLALNGFLLDNASLTVDGKVVFSDDAEGTPQFKLDGFAVSNGTEKKSHNYYVEWRNYAGSDNALKFARGPEYNTGMV
VWYADSAYTDNWVGVHPGHGFLGVVDSHPEAIVGTLNGKPTVESSTRFQIADAAFSFDKTPAWKVVSPTRGTYTYNGLAG
VPKFDDSKTYINQQIPDAGRILPNLGLKFEVVGQADDNSAGAVRLYR

Specific function: Neutral metalloprotease that is secreted to degrade antibacterial proteins produced by the insect host for its defense (attacins and cecropins). Probably degrades some unknown crucial protein(s) too, since it is toxic when injected to insect larvae [H]

COG id: COG4412

COG function: function code S; Uncharacterized protein conserved in bacteria

Gene ontology:

Cell location: Secreted [H]

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Belongs to the peptidase M6 family [H]

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR012300
- InterPro:   IPR008757 [H]

Pfam domain/function: PF05547 Peptidase_M6 [H]

EC number: NA

Molecular weight: Translated: 75246; Mature: 75246

Theoretical pI: Translated: 4.80; Mature: 4.80

Prosite motif: PS00142 ZINC_PROTEASE

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.0 %Cys     (Translated Protein)
1.2 %Met     (Translated Protein)
1.2 %Cys+Met (Translated Protein)
0.0 %Cys     (Mature Protein)
1.2 %Met     (Mature Protein)
1.2 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKDAKADTKEKLDKPATGTPAATGPVRGGLNGKVPTSPAKQKAYNGDVRKDKVLVLLVEY
CCCCCCCHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHCCCCCCCCCEEEEEEEEE
ADFKHNNIDKEPGYMYSEDFNKEHYEKMLFGDEPFTLDDGSKIETFKQYYEEQSGGSYTV
CCCCCCCCCCCCCCCCCCCCCHHHHHHHHCCCCCEECCCCCHHHHHHHHHHHCCCCCEEE
DGTVTKWLTVPGKAADYGADAATGHDNKGPKGPRDLVKDALKAAVDSGLDLSEFDQFDQY
CCEEEEEEECCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHCCCCHHHHHCCCCE
DVNGDGNKNQPDGLIDHLMIIHAGVGQEAGGGKLGDDAIWSHRWTVGPKPFPIEGTQAKV
ECCCCCCCCCCHHHHHHHHHEECCCCCCCCCCCCCCCCCCCCEEECCCCCCCCCCCCEEC
PYWGGKMAAFDYTIEPEDGAVGVFAHEYGHDLGLPDEYDTQYSGHGEPVQAWSIMSGGSW
CCCCCEEEEEEEEECCCCCEEEEEEHHCCCCCCCCCCCCCCCCCCCCCEEEEEEECCCCC
AGKIAGTTPTSFSPQNKEFFQKTIGGNWANIVEVDYEKLNKGIGLATYLDQSVTKTNRPG
CCEECCCCCCCCCCCCHHHHHHHHCCCEEEEEEECHHHHCCCCCCHHHHHHHHHCCCCCC
MIRVNLPDKDIKTIDPAFGKQYYYSTKGDDLHTKLETPLFDLTNATTAKFDFKSLYEIEA
EEEEECCCCCCCCCCHHHCCCEEEECCCCCCCCCCCCCEEECCCCCEEEECHHHHEEEEC
EYDFLEVHAVTEDGQQTLIERLGEKANNGNADSTNGKWIDKSYDLSQFKGKKVKLTFDYI
CCCEEEEEEECCCHHHHHHHHHHHCCCCCCCCCCCCEEECCCCCHHHCCCCEEEEEEEEE
TDGGLALNGFLLDNASLTVDGKVVFSDDAEGTPQFKLDGFAVSNGTEKKSHNYYVEWRNY
CCCCEEEEEEEEECCEEEECCEEEECCCCCCCCCEEECCEEECCCCCCCCCCEEEEEECC
AGSDNALKFARGPEYNTGMVVWYADSAYTDNWVGVHPGHGFLGVVDSHPEAIVGTLNGKP
CCCCCCEEECCCCCCCCCEEEEEECCCCCCCEEEECCCCCEEEEECCCCCEEEEECCCCC
TVESSTRFQIADAAFSFDKTPAWKVVSPTRGTYTYNGLAGVPKFDDSKTYINQQIPDAGR
CCCCCCEEEEEHHEECCCCCCCEEEECCCCCCEEECCCCCCCCCCCCHHHHHHCCCCHHH
ILPNLGLKFEVVGQADDNSAGAVRLYR
HHCCCCCEEEEEECCCCCCCCEEEEEC
>Mature Secondary Structure
MKDAKADTKEKLDKPATGTPAATGPVRGGLNGKVPTSPAKQKAYNGDVRKDKVLVLLVEY
CCCCCCCHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHCCCCCCCCCEEEEEEEEE
ADFKHNNIDKEPGYMYSEDFNKEHYEKMLFGDEPFTLDDGSKIETFKQYYEEQSGGSYTV
CCCCCCCCCCCCCCCCCCCCCHHHHHHHHCCCCCEECCCCCHHHHHHHHHHHCCCCCEEE
DGTVTKWLTVPGKAADYGADAATGHDNKGPKGPRDLVKDALKAAVDSGLDLSEFDQFDQY
CCEEEEEEECCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHCCCCHHHHHCCCCE
DVNGDGNKNQPDGLIDHLMIIHAGVGQEAGGGKLGDDAIWSHRWTVGPKPFPIEGTQAKV
ECCCCCCCCCCHHHHHHHHHEECCCCCCCCCCCCCCCCCCCCEEECCCCCCCCCCCCEEC
PYWGGKMAAFDYTIEPEDGAVGVFAHEYGHDLGLPDEYDTQYSGHGEPVQAWSIMSGGSW
CCCCCEEEEEEEEECCCCCEEEEEEHHCCCCCCCCCCCCCCCCCCCCCEEEEEEECCCCC
AGKIAGTTPTSFSPQNKEFFQKTIGGNWANIVEVDYEKLNKGIGLATYLDQSVTKTNRPG
CCEECCCCCCCCCCCCHHHHHHHHCCCEEEEEEECHHHHCCCCCCHHHHHHHHHCCCCCC
MIRVNLPDKDIKTIDPAFGKQYYYSTKGDDLHTKLETPLFDLTNATTAKFDFKSLYEIEA
EEEEECCCCCCCCCCHHHCCCEEEECCCCCCCCCCCCCEEECCCCCEEEECHHHHEEEEC
EYDFLEVHAVTEDGQQTLIERLGEKANNGNADSTNGKWIDKSYDLSQFKGKKVKLTFDYI
CCCEEEEEEECCCHHHHHHHHHHHCCCCCCCCCCCCEEECCCCCHHHCCCCEEEEEEEEE
TDGGLALNGFLLDNASLTVDGKVVFSDDAEGTPQFKLDGFAVSNGTEKKSHNYYVEWRNY
CCCCEEEEEEEEECCEEEECCEEEECCCCCCCCCEEECCEEECCCCCCCCCCEEEEEECC
AGSDNALKFARGPEYNTGMVVWYADSAYTDNWVGVHPGHGFLGVVDSHPEAIVGTLNGKP
CCCCCCEEECCCCCCCCCEEEEEECCCCCCCEEEECCCCCEEEEECCCCCEEEEECCCCC
TVESSTRFQIADAAFSFDKTPAWKVVSPTRGTYTYNGLAGVPKFDDSKTYINQQIPDAGR
CCCCCCEEEEEHHEECCCCCCCEEEECCCCCCEEECCCCCCCCCCCCHHHHHHCCCCHHH
ILPNLGLKFEVVGQADDNSAGAVRLYR
HHCCCCCEEEEEECCCCCCCCEEEEEC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 2089225; 6421577 [H]