The gene/protein map for NC_012581 is currently unavailable.
Definition Bacillus anthracis str. CDC 684, complete genome.
Accession NC_012581
Length 5,230,115

Click here to switch to the map view.

The map label for this gene is hisF

Identifier: 227815742

GI number: 227815742

Start: 2884767

End: 2885525

Strand: Reverse

Name: hisF

Synonym: BAMEG_3165

Alternate gene names: 227815742

Gene position: 2885525-2884767 (Counterclockwise)

Preceding gene: 227815743

Following gene: 227815741

Centisome position: 55.17

GC content: 40.32

Gene sequence:

>759_bases
ATGTTAGCGAAACGTATTATTCCATGTCTAGATGTGAAAGAAGGGCGAGTCGTAAAGGGGGTAAATTTTATAGGGTTACA
AGATGTCGGTGATCCTGTTGAAATAGCAGCTTTATATAATGATGCGGGAGCAGATGAAATAGTATTTTTAGATATTACGG
CAACGCATGAAGGACGAAAAACAATTATAGATGTTGTAGAAAAAACGGCTTCAAAAGTATTTATTCCTCTTACAGTTGGC
GGAGGAATTTCAAGTGTGAAAGATATGTACAATTTACTAAGAGCGGGAGCAGATAAAGTTTCAATTAACTCAGCAGCAGT
GCGAAATCCAAAATTAATCGAAGAAGGGGCACAGCACTTTGGTTCACAATGTATTGTCGTAGCAATTGATGCTAGAAAAG
TAGCAGAAGGTAAGTGGAATGTATATGTGAACGGCGGAAGAGTTGATACGGGAATGGATGCAATTGGGTGGGCAAAGCGC
GTTGTTATGCTTGGTGCCGGCGAAATTTTGTTAACGAGTATGGATGCAGATGGAACGAAAAACGGATATGACCTTCGTTT
AACAGAAGAAATTTCAAAAAGTGTTTCCATACCAGTCATTGCGTCGGGTGGATGTGGTCATGCTGATCACATTATAGAAG
TGTTTCAAAAGACAACAGTAGATGCAGCGTTAGCGGCATCAATCTTTCATTACGGTGAGGCGACAATAGGGGACGTAAAG
AGAAAATTAAGAAATGCAAACGTCGAGGTGCGGTTATGA

Upstream 100 bases:

>100_bases
TGAAAAAGTTAAATGATATGAACATATACGGCGTCATAATTGGTAAGGCTCTTTACGAGAAAACGATTGATTTAGAAGAA
GTGGTAGAGGTAACAAAGTT

Downstream 100 bases:

>100_bases
AACCTAACTTTTCAAAAGGACTATTACCGGCAGTTGTAATTGAAGAAGGTACAAAAGAAGTTTTAATGCTAGCTTATATG
AATGAAGAAGCATATGAAAA

Product: imidazole glycerol phosphate synthase subunit HisF

Products: NA

Alternate protein names: IGP synthase cyclase subunit; IGP synthase subunit hisF; ImGP synthase subunit hisF; IGPS subunit hisF

Number of amino acids: Translated: 252; Mature: 252

Protein sequence:

>252_residues
MLAKRIIPCLDVKEGRVVKGVNFIGLQDVGDPVEIAALYNDAGADEIVFLDITATHEGRKTIIDVVEKTASKVFIPLTVG
GGISSVKDMYNLLRAGADKVSINSAAVRNPKLIEEGAQHFGSQCIVVAIDARKVAEGKWNVYVNGGRVDTGMDAIGWAKR
VVMLGAGEILLTSMDADGTKNGYDLRLTEEISKSVSIPVIASGGCGHADHIIEVFQKTTVDAALAASIFHYGEATIGDVK
RKLRNANVEVRL

Sequences:

>Translated_252_residues
MLAKRIIPCLDVKEGRVVKGVNFIGLQDVGDPVEIAALYNDAGADEIVFLDITATHEGRKTIIDVVEKTASKVFIPLTVG
GGISSVKDMYNLLRAGADKVSINSAAVRNPKLIEEGAQHFGSQCIVVAIDARKVAEGKWNVYVNGGRVDTGMDAIGWAKR
VVMLGAGEILLTSMDADGTKNGYDLRLTEEISKSVSIPVIASGGCGHADHIIEVFQKTTVDAALAASIFHYGEATIGDVK
RKLRNANVEVRL
>Mature_252_residues
MLAKRIIPCLDVKEGRVVKGVNFIGLQDVGDPVEIAALYNDAGADEIVFLDITATHEGRKTIIDVVEKTASKVFIPLTVG
GGISSVKDMYNLLRAGADKVSINSAAVRNPKLIEEGAQHFGSQCIVVAIDARKVAEGKWNVYVNGGRVDTGMDAIGWAKR
VVMLGAGEILLTSMDADGTKNGYDLRLTEEISKSVSIPVIASGGCGHADHIIEVFQKTTVDAALAASIFHYGEATIGDVK
RKLRNANVEVRL

Specific function: IGPS catalyzes the conversion of PRFAR and glutamine to IGP, AICAR and glutamate. The hisF subunit catalyzes the cyclization activity that produces IGP and AICAR from PRFAR using the ammonia provided by the hisH subunit

COG id: COG0107

COG function: function code E; Imidazoleglycerol-phosphate synthase

Gene ontology:

Cell location: Cytoplasm

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the hisA/hisF family

Homologues:

Organism=Escherichia coli, GI1788336, Length=258, Percent_Identity=46.5116279069767, Blast_Score=213, Evalue=1e-56,
Organism=Escherichia coli, GI87082028, Length=210, Percent_Identity=29.0476190476191, Blast_Score=88, Evalue=6e-19,
Organism=Saccharomyces cerevisiae, GI6319725, Length=314, Percent_Identity=34.0764331210191, Blast_Score=155, Evalue=4e-39,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): HIS6_BACAA (C3P506)

Other databases:

- EMBL:   CP001598
- RefSeq:   YP_002865922.1
- ProteinModelPortal:   C3P506
- SMR:   C3P506
- EnsemblBacteria:   EBBACT00000127668
- GeneID:   7850589
- GenomeReviews:   CP001598_GR
- KEGG:   bai:BAA_1497
- GeneTree:   EBGT00050000001074
- ProtClustDB:   PRK02083
- GO:   GO:0005737
- HAMAP:   MF_01013
- InterPro:   IPR013785
- InterPro:   IPR006062
- InterPro:   IPR004651
- InterPro:   IPR011060
- Gene3D:   G3DSA:3.20.20.70
- TIGRFAMs:   TIGR00735

Pfam domain/function: PF00977 His_biosynth; SSF51366 RibP_bind_barrel

EC number: 4.1.3.-

Molecular weight: Translated: 26874; Mature: 26874

Theoretical pI: Translated: 6.36; Mature: 6.36

Prosite motif: NA

Important sites: ACT_SITE 11-11 ACT_SITE 130-130

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.2 %Cys     (Translated Protein)
2.0 %Met     (Translated Protein)
3.2 %Cys+Met (Translated Protein)
1.2 %Cys     (Mature Protein)
2.0 %Met     (Mature Protein)
3.2 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MLAKRIIPCLDVKEGRVVKGVNFIGLQDVGDPVEIAALYNDAGADEIVFLDITATHEGRK
CCHHHCCCCCCCCCCCEEECEEEEEECCCCCCEEEEEEECCCCCCEEEEEEEEECCCCHH
TIIDVVEKTASKVFIPLTVGGGISSVKDMYNLLRAGADKVSINSAAVRNPKLIEEGAQHF
HHHHHHHHHHCEEEEEEEECCCHHHHHHHHHHHHCCCCEEEECCHHCCCCHHHHHHHHHH
GSQCIVVAIDARKVAEGKWNVYVNGGRVDTGMDAIGWAKRVVMLGAGEILLTSMDADGTK
CCEEEEEEEECEECCCCEEEEEEECCEECCCCHHHHHHHHEEEEECCEEEEEECCCCCCC
NGYDLRLTEEISKSVSIPVIASGGCGHADHIIEVFQKTTVDAALAASIFHYGEATIGDVK
CCEEEEEHHHHHCCCCCEEEECCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHH
RKLRNANVEVRL
HHHHCCCEEEEC
>Mature Secondary Structure
MLAKRIIPCLDVKEGRVVKGVNFIGLQDVGDPVEIAALYNDAGADEIVFLDITATHEGRK
CCHHHCCCCCCCCCCCEEECEEEEEECCCCCCEEEEEEECCCCCCEEEEEEEEECCCCHH
TIIDVVEKTASKVFIPLTVGGGISSVKDMYNLLRAGADKVSINSAAVRNPKLIEEGAQHF
HHHHHHHHHHCEEEEEEEECCCHHHHHHHHHHHHCCCCEEEECCHHCCCCHHHHHHHHHH
GSQCIVVAIDARKVAEGKWNVYVNGGRVDTGMDAIGWAKRVVMLGAGEILLTSMDADGTK
CCEEEEEEEECEECCCCEEEEEEECCEECCCCHHHHHHHHEEEEECCEEEEEECCCCCCC
NGYDLRLTEEISKSVSIPVIASGGCGHADHIIEVFQKTTVDAALAASIFHYGEATIGDVK
CCEEEEEHHHHHCCCCCEEEECCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHH
RKLRNANVEVRL
HHHHCCCEEEEC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: Lyases; Carbon-Nitrogen Lyases; Amidine-Lyases [C]

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: NA