The gene/protein map for NC_012581 is currently unavailable.
Definition Bacillus anthracis str. CDC 684, complete genome.
Accession NC_012581
Length 5,230,115

Click here to switch to the map view.

The map label for this gene is phoB [H]

Identifier: 227814196

GI number: 227814196

Start: 1467386

End: 1469059

Strand: Direct

Name: phoB [H]

Synonym: BAMEG_1604

Alternate gene names: 227814196

Gene position: 1467386-1469059 (Clockwise)

Preceding gene: 227814193

Following gene: 227814197

Centisome position: 28.06

GC content: 36.98

Gene sequence:

>1674_bases
ATGTCGGAGTTAGCTTTAAAGATGAAGAGATTACTGTTAGTAGGAACAATCATACTAAGTATGTTATGTACTGAAAGTTT
GATGAATTATCATACAGCGGAAGCTAAAGTGAAAAAAGTAGAACGCAAGCCTAAAAATGTAATCATAATGGTTATGGACG
GAACAAGTTCTACAGCAACTACATTAGCTCGCTTGTATAAAGGGAAACCACTTGCATTAGACGAAATTGTAACAGGAGGA
GTTCGTACATATTCGGCGGAATCAGCTATAACAGACTCAGCTCCAGCAGCTACAGCTTTAGCGACGGGGAATAAATCAAA
TTCAGGATATGTAGGTGTATTACCTTCAATTGTAAGTTCATCTGGCTTAAAACCAATGAAAGAAGAGGATAAGTTACGAC
CAGTTGCCAATGTTTTAGAAGGTGCAAAACGTACGGGTCGCGCAACTGGAATTGTTGCTACAGCTGAAATTCAGCATGCT
ACTCCTGCTGGATTCTCCGCTCATCATGTGAATCGTAACAATTTCGAAGTGCTCGCGGAGCAACAAGTATATCAAAATAT
AGATGTCGTATTAGGTGGGGGAAAAGCAGCACTTCTACCTGAGACAGATAGTGGGATTCGAAAAGACGGTGAAGATTTAG
TAAAAGTGATCAAAAACAAAGGTTACGACTTTGTTGAAACGAAAGAAGCATTATTAGGCTCTAAATCTAATAAAATTTGG
GGCTCTTTCTCGCTTAATGCTTTAGCATTTGATATGGATCGTGAAGCAACAAACCCAGAGCAACCAACACTTTCTCAAAT
GACGGAAAAAGCAATTCAAACGTTATCAAAAGATAAAGATGGCTTCTTTTTATTTGTGGAAGGAAGTAAGCCAGACTGGG
CAGCTCATGTGAATGATCCAATTGGGATGATTAGTGATGTATTAGCATTTGATAATGCAGTTGCAGAAGCATTGAAGTTT
GCAAAAAAAGATGGTAATACGATGCTAATAGCCGTAGCGGACCATGGTAATAGCGGTATTTCTATTGGGAATATGAATAC
GACAAAAGGATATAATACTACGCCGATCTCTGCGTACATTTATCCATTGAAAAAAGCGAAGATGACACTTGAAGGGACTA
TCAATAATTTGAAAGCTGATATATCAAATGTAGAAGAGGTAGCTAAATTATACGGGTTGGACAATTTAACTTATGATGAA
AAAGAAAGGTTAAAAACGGCTAAAAAGAAAATAGATGTAGGTCCAATTTTCACTACATTATTGTCTAAGCGTGCGAACAT
AGGCTTCACAACAGGAGGGCATACAGGTGAGGATGTATTCTTATATTCATACGGTCCTCAAAAGCCATACGGTTTGATTC
AAAATACGGACGTTGCGAAGACGATGGCGAAAGCGATGGGCTTTAACTTAGAAAAAGTAACAAACAAATTATTTGTAGAA
AGTGAATCAGCCATTAAGCAGAATGATGCAGCTGTAACAATAGATAAAACTGATGTAGCGAACCCTGTACTCATAGTAAA
ACGTAATAATGTAACAGCTCAATTATTTGTTAACAAAAATATAATTCGTATTAAGAATAAAGAGTATGAATTAGGAAGTG
TTGTTGTAGAAAGTAATGGAAAGGTTTACGTACCAGAAGAAGCAATTCATCTATTTAGAAAACATTCTCGTTAA

Upstream 100 bases:

>100_bases
ATAAGAATTGGGAACTAATAAAACATATATAGGTTGTGAAAAGTAAAACGAAACCAGAACTTTGTATGTAAATGAATGCG
AAACAAATGGAGGCGCAATA

Downstream 100 bases:

>100_bases
AAGATTGCCAACCACTTACCTTAATTAGGAGGAGTGGTTGGCAATTTTTTGTTTAGTAAACGTAAGCAATTTGTAAGGAG
TGAGTAAGAAAAAAGAGAAT

Product: alkaline phosphatase

Products: NA

Alternate protein names: Alkaline phosphatase III; APase III [H]

Number of amino acids: Translated: 557; Mature: 556

Protein sequence:

>557_residues
MSELALKMKRLLLVGTIILSMLCTESLMNYHTAEAKVKKVERKPKNVIIMVMDGTSSTATTLARLYKGKPLALDEIVTGG
VRTYSAESAITDSAPAATALATGNKSNSGYVGVLPSIVSSSGLKPMKEEDKLRPVANVLEGAKRTGRATGIVATAEIQHA
TPAGFSAHHVNRNNFEVLAEQQVYQNIDVVLGGGKAALLPETDSGIRKDGEDLVKVIKNKGYDFVETKEALLGSKSNKIW
GSFSLNALAFDMDREATNPEQPTLSQMTEKAIQTLSKDKDGFFLFVEGSKPDWAAHVNDPIGMISDVLAFDNAVAEALKF
AKKDGNTMLIAVADHGNSGISIGNMNTTKGYNTTPISAYIYPLKKAKMTLEGTINNLKADISNVEEVAKLYGLDNLTYDE
KERLKTAKKKIDVGPIFTTLLSKRANIGFTTGGHTGEDVFLYSYGPQKPYGLIQNTDVAKTMAKAMGFNLEKVTNKLFVE
SESAIKQNDAAVTIDKTDVANPVLIVKRNNVTAQLFVNKNIIRIKNKEYELGSVVVESNGKVYVPEEAIHLFRKHSR

Sequences:

>Translated_557_residues
MSELALKMKRLLLVGTIILSMLCTESLMNYHTAEAKVKKVERKPKNVIIMVMDGTSSTATTLARLYKGKPLALDEIVTGG
VRTYSAESAITDSAPAATALATGNKSNSGYVGVLPSIVSSSGLKPMKEEDKLRPVANVLEGAKRTGRATGIVATAEIQHA
TPAGFSAHHVNRNNFEVLAEQQVYQNIDVVLGGGKAALLPETDSGIRKDGEDLVKVIKNKGYDFVETKEALLGSKSNKIW
GSFSLNALAFDMDREATNPEQPTLSQMTEKAIQTLSKDKDGFFLFVEGSKPDWAAHVNDPIGMISDVLAFDNAVAEALKF
AKKDGNTMLIAVADHGNSGISIGNMNTTKGYNTTPISAYIYPLKKAKMTLEGTINNLKADISNVEEVAKLYGLDNLTYDE
KERLKTAKKKIDVGPIFTTLLSKRANIGFTTGGHTGEDVFLYSYGPQKPYGLIQNTDVAKTMAKAMGFNLEKVTNKLFVE
SESAIKQNDAAVTIDKTDVANPVLIVKRNNVTAQLFVNKNIIRIKNKEYELGSVVVESNGKVYVPEEAIHLFRKHSR
>Mature_556_residues
SELALKMKRLLLVGTIILSMLCTESLMNYHTAEAKVKKVERKPKNVIIMVMDGTSSTATTLARLYKGKPLALDEIVTGGV
RTYSAESAITDSAPAATALATGNKSNSGYVGVLPSIVSSSGLKPMKEEDKLRPVANVLEGAKRTGRATGIVATAEIQHAT
PAGFSAHHVNRNNFEVLAEQQVYQNIDVVLGGGKAALLPETDSGIRKDGEDLVKVIKNKGYDFVETKEALLGSKSNKIWG
SFSLNALAFDMDREATNPEQPTLSQMTEKAIQTLSKDKDGFFLFVEGSKPDWAAHVNDPIGMISDVLAFDNAVAEALKFA
KKDGNTMLIAVADHGNSGISIGNMNTTKGYNTTPISAYIYPLKKAKMTLEGTINNLKADISNVEEVAKLYGLDNLTYDEK
ERLKTAKKKIDVGPIFTTLLSKRANIGFTTGGHTGEDVFLYSYGPQKPYGLIQNTDVAKTMAKAMGFNLEKVTNKLFVES
ESAIKQNDAAVTIDKTDVANPVLIVKRNNVTAQLFVNKNIIRIKNKEYELGSVVVESNGKVYVPEEAIHLFRKHSR

Specific function: Unknown

COG id: COG1785

COG function: function code P; Alkaline phosphatase

Gene ontology:

Cell location: Periplasmic Protein [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the alkaline phosphatase family [H]

Homologues:

Organism=Homo sapiens, GI157266292, Length=536, Percent_Identity=25.5597014925373, Blast_Score=139, Evalue=8e-33,
Organism=Homo sapiens, GI94721246, Length=490, Percent_Identity=27.3469387755102, Blast_Score=137, Evalue=2e-32,
Organism=Homo sapiens, GI157266296, Length=490, Percent_Identity=27.1428571428571, Blast_Score=135, Evalue=1e-31,
Organism=Homo sapiens, GI116734717, Length=338, Percent_Identity=29.585798816568, Blast_Score=117, Evalue=2e-26,
Organism=Homo sapiens, GI294660770, Length=334, Percent_Identity=28.7425149700599, Blast_Score=109, Evalue=6e-24,
Organism=Homo sapiens, GI294660772, Length=290, Percent_Identity=30, Blast_Score=106, Evalue=7e-23,
Organism=Escherichia coli, GI48994877, Length=365, Percent_Identity=31.7808219178082, Blast_Score=135, Evalue=1e-32,
Organism=Saccharomyces cerevisiae, GI6320689, Length=556, Percent_Identity=28.9568345323741, Blast_Score=180, Evalue=7e-46,
Organism=Drosophila melanogaster, GI24657827, Length=473, Percent_Identity=28.9640591966173, Blast_Score=136, Evalue=3e-32,
Organism=Drosophila melanogaster, GI19921912, Length=483, Percent_Identity=28.1573498964803, Blast_Score=135, Evalue=5e-32,
Organism=Drosophila melanogaster, GI85725200, Length=342, Percent_Identity=30.4093567251462, Blast_Score=134, Evalue=2e-31,
Organism=Drosophila melanogaster, GI85815833, Length=342, Percent_Identity=30.4093567251462, Blast_Score=134, Evalue=2e-31,
Organism=Drosophila melanogaster, GI21355981, Length=327, Percent_Identity=31.4984709480122, Blast_Score=133, Evalue=3e-31,
Organism=Drosophila melanogaster, GI24657835, Length=475, Percent_Identity=28.6315789473684, Blast_Score=130, Evalue=2e-30,
Organism=Drosophila melanogaster, GI21355149, Length=339, Percent_Identity=29.7935103244838, Blast_Score=127, Evalue=3e-29,
Organism=Drosophila melanogaster, GI24657842, Length=473, Percent_Identity=28.1183932346723, Blast_Score=121, Evalue=1e-27,
Organism=Drosophila melanogaster, GI18859923, Length=432, Percent_Identity=27.0833333333333, Blast_Score=120, Evalue=2e-27,
Organism=Drosophila melanogaster, GI21355151, Length=349, Percent_Identity=29.512893982808, Blast_Score=119, Evalue=4e-27,
Organism=Drosophila melanogaster, GI24585213, Length=342, Percent_Identity=30.4093567251462, Blast_Score=119, Evalue=8e-27,
Organism=Drosophila melanogaster, GI21358067, Length=340, Percent_Identity=28.2352941176471, Blast_Score=111, Evalue=1e-24,
Organism=Drosophila melanogaster, GI24651554, Length=476, Percent_Identity=25.4201680672269, Blast_Score=111, Evalue=1e-24,

Paralogues:

None

Copy number: 340 Molecules/Cell In: Growth Phase, Glucose-minimal MOPS Media. [C]

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR017849
- InterPro:   IPR001952
- InterPro:   IPR018299
- InterPro:   IPR017850 [H]

Pfam domain/function: PF00245 Alk_phosphatase [H]

EC number: =3.1.3.1 [H]

Molecular weight: Translated: 60488; Mature: 60357

Theoretical pI: Translated: 9.45; Mature: 9.45

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.2 %Cys     (Translated Protein)
2.7 %Met     (Translated Protein)
2.9 %Cys+Met (Translated Protein)
0.2 %Cys     (Mature Protein)
2.5 %Met     (Mature Protein)
2.7 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSELALKMKRLLLVGTIILSMLCTESLMNYHTAEAKVKKVERKPKNVIIMVMDGTSSTAT
CCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCEEEEEECCCCHHHH
TLARLYKGKPLALDEIVTGGVRTYSAESAITDSAPAATALATGNKSNSGYVGVLPSIVSS
HHHHHHCCCCCCHHHHHCCCCEEECCCCCCCCCCCCCEEEECCCCCCCCEEEEHHHHHCC
SGLKPMKEEDKLRPVANVLEGAKRTGRATGIVATAEIQHATPAGFSAHHVNRNNFEVLAE
CCCCCCCHHHHHHHHHHHHHHHHHCCCCCEEEEEEEECCCCCCCCCEECCCCCCHHHEEH
QQVYQNIDVVLGGGKAALLPETDSGIRKDGEDLVKVIKNKGYDFVETKEALLGSKSNKIW
HHHHCCCEEEEECCCEEECCCCCCCCCCCHHHHHHHHHHCCCCHHHHHHHHHCCCCCCEE
GSFSLNALAFDMDREATNPEQPTLSQMTEKAIQTLSKDKDGFFLFVEGSKPDWAAHVNDP
EEEECCEEEEECCCCCCCCCCCHHHHHHHHHHHHHHCCCCCEEEEEECCCCCCEEECCCH
IGMISDVLAFDNAVAEALKFAKKDGNTMLIAVADHGNSGISIGNMNTTKGYNTTPISAYI
HHHHHHHHHHHHHHHHHHHHHHCCCCEEEEEEEECCCCCEEECCCCCCCCCCCCCCEEEE
YPLKKAKMTLEGTINNLKADISNVEEVAKLYGLDNLTYDEKERLKTAKKKIDVGPIFTTL
EEHHHHEEEEEHHHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHCCCHHHHHHH
LSKRANIGFTTGGHTGEDVFLYSYGPQKPYGLIQNTDVAKTMAKAMGFNLEKVTNKLFVE
HHCCCCCCEECCCCCCCEEEEEECCCCCCCCCCCCCHHHHHHHHHHCCCHHHHHHHHEEC
SESAIKQNDAAVTIDKTDVANPVLIVKRNNVTAQLFVNKNIIRIKNKEYELGSVVVESNG
CCHHHCCCCCEEEEECCCCCCCEEEEEECCEEEEEEECCCEEEEECCCEEECEEEEECCC
KVYVPEEAIHLFRKHSR
CEECCHHHHHHHHHCCC
>Mature Secondary Structure 
SELALKMKRLLLVGTIILSMLCTESLMNYHTAEAKVKKVERKPKNVIIMVMDGTSSTAT
CHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCEEEEEECCCCHHHH
TLARLYKGKPLALDEIVTGGVRTYSAESAITDSAPAATALATGNKSNSGYVGVLPSIVSS
HHHHHHCCCCCCHHHHHCCCCEEECCCCCCCCCCCCCEEEECCCCCCCCEEEEHHHHHCC
SGLKPMKEEDKLRPVANVLEGAKRTGRATGIVATAEIQHATPAGFSAHHVNRNNFEVLAE
CCCCCCCHHHHHHHHHHHHHHHHHCCCCCEEEEEEEECCCCCCCCCEECCCCCCHHHEEH
QQVYQNIDVVLGGGKAALLPETDSGIRKDGEDLVKVIKNKGYDFVETKEALLGSKSNKIW
HHHHCCCEEEEECCCEEECCCCCCCCCCCHHHHHHHHHHCCCCHHHHHHHHHCCCCCCEE
GSFSLNALAFDMDREATNPEQPTLSQMTEKAIQTLSKDKDGFFLFVEGSKPDWAAHVNDP
EEEECCEEEEECCCCCCCCCCCHHHHHHHHHHHHHHCCCCCEEEEEECCCCCCEEECCCH
IGMISDVLAFDNAVAEALKFAKKDGNTMLIAVADHGNSGISIGNMNTTKGYNTTPISAYI
HHHHHHHHHHHHHHHHHHHHHHCCCCEEEEEEEECCCCCEEECCCCCCCCCCCCCCEEEE
YPLKKAKMTLEGTINNLKADISNVEEVAKLYGLDNLTYDEKERLKTAKKKIDVGPIFTTL
EEHHHHEEEEEHHHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHCCCHHHHHHH
LSKRANIGFTTGGHTGEDVFLYSYGPQKPYGLIQNTDVAKTMAKAMGFNLEKVTNKLFVE
HHCCCCCCEECCCCCCCEEEEEECCCCCCCCCCCCCHHHHHHHHHHCCCHHHHHHHHEEC
SESAIKQNDAAVTIDKTDVANPVLIVKRNNVTAQLFVNKNIIRIKNKEYELGSVVVESNG
CCHHHCCCCCEEEEECCCCCCCEEEEEECCEEEEEEECCCEEEEECCCEEECEEEEECCC
KVYVPEEAIHLFRKHSR
CEECCHHHHHHHHHCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 1898729; 9202461; 9384377; 2113910; 2105301 [H]