| Definition | Clostridium botulinum A str. ATCC 3502, complete genome. |
|---|---|
| Accession | NC_009495 |
| Length | 3,886,916 |
Click here to switch to the map view.
The map label for this gene is purF [H]
Identifier: 148380834
GI number: 148380834
Start: 3060247
End: 3061695
Strand: Reverse
Name: purF [H]
Synonym: CBO2876
Alternate gene names: 148380834
Gene position: 3061695-3060247 (Counterclockwise)
Preceding gene: 148380835
Following gene: 148380833
Centisome position: 78.77
GC content: 32.64
Gene sequence:
>1449_bases ATGAGTATGTGCTATATGTTAGATGATTTAAATGAAAATATGCCCTTTGATTTAGAAGGAGATAAGTTTAAAGAAGAATG TGGGGTATTTGGAGTATTTTCTAAAGATAATGAATCAAAGTCAGCAGAAATAACTTATTACGGATTATATGCTCTTCAAC ATAGGGGACAAGAAAGTGCAGGAATAGTAGTATCTGATGGAGAAAAATTTAAATATCATAAGGGTATGGGTCTTGTATCG GATGTTTTTAGCAAAGAAACTATAGAAGGATTAATAGGAAATTCTGCTATAGGACATGTTAGATATTCAACTACAGGAGC GAGTAAATCAGATAATGCACAACCTATAGTAGGTACTTATAAGTTAGGTTCTATTGCTATAGCTCATAATGGTAATTTAG TTAATGCAGCAGTTATAAGAGAACTTTTAGAAGATGGCGGATGTATTTTTCAAACTTCTATAGACACAGAGGTATTATTA AACTTAATAGCAAGAAGCGCTAAAAAAGGTATAGATAAAGCAGTAGTAGATGCAATACAAGCAATTAAAGGTTCCTATGC TATCGTTATACTTACAGAAGATAAGTTAATAGGAGCACGTGATCCTCATGGTATAAGGCCTATGTGCCTAGGAAAAATTG GGGATGATTATTTATTAAGCTCGGAAAGTTGTGCTTTTGATTGCGTAGGTGGAGAGTTTATAAGGGATATAGAGCCTGGA GAAATAGTTATTATAGACGAAAGTGGAATAAATTCAATTAAGTTTACAGAAAAAACAAGATGTCATACCTGTGCTTTTGA ATATATATATTTTGCAAGACCAGATAGTACTATGGATGGTATAAATGTTTATGAATCAAGGATTAGAGCGGGAAGAAAAC TTTATGAAGAATACCCAGTAGAGGCAGATATAGTTATAGGAGTCCCAGACTCAGGTATACCAGCTGCGGTAGGATATGCT GAAGCTTCAGGAATACCTTATGGTATAGGATTTATAAAAAATAAATATGTGGGAAGAACTTTTATAGCACCTTCTCAAGA ATTAAGAGAAAAAGCTGTATCTGTAAAACTAAATCCACTTAAAATAAATGTAGAAGGAAAAAGAGTAGTAATAATAGATG ATTCCATAGTAAGAGGAACTACTAGTAAAAGATTAGTACAAATATTAAGAAAAGCTGGAGCTAAGGAAGTTCATTTTAGA GTATCATCTCCAGTGGTTAAATATCCTTGCTATTTTGGAATAGATACTCCTTATAGAAAAGATTTAATAGGTGCTCACTC AGAAGTAGAAGAAATAAGAGAAAAAATAGGAGCAGATAGTCTAGCTTATATAAGTATGGAAGGCTTAGTAGAAACACTTA ATAAAGATAAAGGTTTTTGCTTGGGATGTTTTAATGGCGTATATCCTATATCTGCACCTATAGAAATGCCTAAAGATAGT TTGGAATAG
Upstream 100 bases:
>100_bases AATAAATAGATTGTTATAGTTTAAAATTATTTTTACAGCAGCTGGAAATAATCTAAGAGAAGATTAAATTTTTAAAATAG AAAATAAGTGGGGAGTAAAA
Downstream 100 bases:
>100_bases GGAATTTAAGTTTTTTAAATTTTGAGAATAACTAATAATGTAAAGAAGGGAATGTTATTCATGGTATCTTATAAAGAAGC TGGGGTTAATATAGAGGAAG
Product: amidophosphoribosyltransferase
Products: NA
Alternate protein names: ATase; Glutamine phosphoribosylpyrophosphate amidotransferase; GPATase [H]
Number of amino acids: Translated: 482; Mature: 481
Protein sequence:
>482_residues MSMCYMLDDLNENMPFDLEGDKFKEECGVFGVFSKDNESKSAEITYYGLYALQHRGQESAGIVVSDGEKFKYHKGMGLVS DVFSKETIEGLIGNSAIGHVRYSTTGASKSDNAQPIVGTYKLGSIAIAHNGNLVNAAVIRELLEDGGCIFQTSIDTEVLL NLIARSAKKGIDKAVVDAIQAIKGSYAIVILTEDKLIGARDPHGIRPMCLGKIGDDYLLSSESCAFDCVGGEFIRDIEPG EIVIIDESGINSIKFTEKTRCHTCAFEYIYFARPDSTMDGINVYESRIRAGRKLYEEYPVEADIVIGVPDSGIPAAVGYA EASGIPYGIGFIKNKYVGRTFIAPSQELREKAVSVKLNPLKINVEGKRVVIIDDSIVRGTTSKRLVQILRKAGAKEVHFR VSSPVVKYPCYFGIDTPYRKDLIGAHSEVEEIREKIGADSLAYISMEGLVETLNKDKGFCLGCFNGVYPISAPIEMPKDS LE
Sequences:
>Translated_482_residues MSMCYMLDDLNENMPFDLEGDKFKEECGVFGVFSKDNESKSAEITYYGLYALQHRGQESAGIVVSDGEKFKYHKGMGLVS DVFSKETIEGLIGNSAIGHVRYSTTGASKSDNAQPIVGTYKLGSIAIAHNGNLVNAAVIRELLEDGGCIFQTSIDTEVLL NLIARSAKKGIDKAVVDAIQAIKGSYAIVILTEDKLIGARDPHGIRPMCLGKIGDDYLLSSESCAFDCVGGEFIRDIEPG EIVIIDESGINSIKFTEKTRCHTCAFEYIYFARPDSTMDGINVYESRIRAGRKLYEEYPVEADIVIGVPDSGIPAAVGYA EASGIPYGIGFIKNKYVGRTFIAPSQELREKAVSVKLNPLKINVEGKRVVIIDDSIVRGTTSKRLVQILRKAGAKEVHFR VSSPVVKYPCYFGIDTPYRKDLIGAHSEVEEIREKIGADSLAYISMEGLVETLNKDKGFCLGCFNGVYPISAPIEMPKDS LE >Mature_481_residues SMCYMLDDLNENMPFDLEGDKFKEECGVFGVFSKDNESKSAEITYYGLYALQHRGQESAGIVVSDGEKFKYHKGMGLVSD VFSKETIEGLIGNSAIGHVRYSTTGASKSDNAQPIVGTYKLGSIAIAHNGNLVNAAVIRELLEDGGCIFQTSIDTEVLLN LIARSAKKGIDKAVVDAIQAIKGSYAIVILTEDKLIGARDPHGIRPMCLGKIGDDYLLSSESCAFDCVGGEFIRDIEPGE IVIIDESGINSIKFTEKTRCHTCAFEYIYFARPDSTMDGINVYESRIRAGRKLYEEYPVEADIVIGVPDSGIPAAVGYAE ASGIPYGIGFIKNKYVGRTFIAPSQELREKAVSVKLNPLKINVEGKRVVIIDDSIVRGTTSKRLVQILRKAGAKEVHFRV SSPVVKYPCYFGIDTPYRKDLIGAHSEVEEIREKIGADSLAYISMEGLVETLNKDKGFCLGCFNGVYPISAPIEMPKDSL E
Specific function: De novo purine biosynthesis; first step. [C]
COG id: COG0034
COG function: function code F; Glutamine phosphoribosylpyrophosphate amidotransferase
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 1 glutamine amidotransferase type-2 domain [H]
Homologues:
Organism=Homo sapiens, GI29570798, Length=514, Percent_Identity=38.9105058365759, Blast_Score=365, Evalue=1e-101, Organism=Escherichia coli, GI1788651, Length=469, Percent_Identity=40.0852878464819, Blast_Score=322, Evalue=4e-89, Organism=Escherichia coli, GI1790167, Length=231, Percent_Identity=30.7359307359307, Blast_Score=90, Evalue=3e-19, Organism=Caenorhabditis elegans, GI17554892, Length=477, Percent_Identity=40.6708595387841, Blast_Score=341, Evalue=4e-94, Organism=Saccharomyces cerevisiae, GI6323958, Length=470, Percent_Identity=38.936170212766, Blast_Score=292, Evalue=7e-80, Organism=Drosophila melanogaster, GI24659598, Length=489, Percent_Identity=41.5132924335378, Blast_Score=383, Evalue=1e-106, Organism=Drosophila melanogaster, GI24659604, Length=464, Percent_Identity=42.4568965517241, Blast_Score=376, Evalue=1e-104, Organism=Drosophila melanogaster, GI28573187, Length=507, Percent_Identity=40.6311637080868, Blast_Score=376, Evalue=1e-104,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR005854 - InterPro: IPR000583 - InterPro: IPR017932 - InterPro: IPR000836 [H]
Pfam domain/function: PF00310 GATase_2; PF00156 Pribosyltran [H]
EC number: =2.4.2.14 [H]
Molecular weight: Translated: 52711; Mature: 52580
Theoretical pI: Translated: 5.10; Mature: 5.10
Prosite motif: PS00103 PUR_PYR_PR_TRANSFER
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
2.3 %Cys (Translated Protein) 1.9 %Met (Translated Protein) 4.1 %Cys+Met (Translated Protein) 2.3 %Cys (Mature Protein) 1.7 %Met (Mature Protein) 4.0 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MSMCYMLDDLNENMPFDLEGDKFKEECGVFGVFSKDNESKSAEITYYGLYALQHRGQESA CCEEEEECCCCCCCCCCCCCCHHHHHCCEEEEEECCCCCCCEEEEEEEEEEEHHCCCCCC GIVVSDGEKFKYHKGMGLVSDVFSKETIEGLIGNSAIGHVRYSTTGASKSDNAQPIVGTY CEEEECCCCEEEECCCCHHHHHHHHHHHHHHHCCCCCCEEEEECCCCCCCCCCCCEEEEE KLGSIAIAHNGNLVNAAVIRELLEDGGCIFQTSIDTEVLLNLIARSAKKGIDKAVVDAIQ EECEEEEEECCCEEHHHHHHHHHHCCCEEEEECCCHHHHHHHHHHHHHHCHHHHHHHHHH AIKGSYAIVILTEDKLIGARDPHGIRPMCLGKIGDDYLLSSESCAFDCVGGEFIRDIEPG HHCCCEEEEEEECCCEECCCCCCCCCCCEECCCCCCCEECCCCCEEEECCCHHHHCCCCC EIVIIDESGINSIKFTEKTRCHTCAFEYIYFARPDSTMDGINVYESRIRAGRKLYEEYPV EEEEEECCCCCCEEECCCCCHHEEEEEEEEEECCCCCCCHHHHHHHHHHHHHHHHHHCCC EADIVIGVPDSGIPAAVGYAEASGIPYGIGFIKNKYVGRTFIAPSQELREKAVSVKLNPL CEEEEEECCCCCCCCEECCHHCCCCCEEHHHHHCCCCCEEECCCCHHHHHHHHEEEEEEE KINVEGKRVVIIDDSIVRGTTSKRLVQILRKAGAKEVHFRVSSPVVKYPCYFGIDTPYRK EEEECCCEEEEECCCCCCCCCHHHHHHHHHHCCCCEEEEEECCCEEECCEEECCCCCHHH DLIGAHSEVEEIREKIGADSLAYISMEGLVETLNKDKGFCLGCFNGVYPISAPIEMPKDS HHHCCHHHHHHHHHHHCCCCEEEEEHHHHHHHHCCCCCEEEEECCCCCCCCCCCCCCCCC LE CC >Mature Secondary Structure SMCYMLDDLNENMPFDLEGDKFKEECGVFGVFSKDNESKSAEITYYGLYALQHRGQESA CEEEEECCCCCCCCCCCCCCHHHHHCCEEEEEECCCCCCCEEEEEEEEEEEHHCCCCCC GIVVSDGEKFKYHKGMGLVSDVFSKETIEGLIGNSAIGHVRYSTTGASKSDNAQPIVGTY CEEEECCCCEEEECCCCHHHHHHHHHHHHHHHCCCCCCEEEEECCCCCCCCCCCCEEEEE KLGSIAIAHNGNLVNAAVIRELLEDGGCIFQTSIDTEVLLNLIARSAKKGIDKAVVDAIQ EECEEEEEECCCEEHHHHHHHHHHCCCEEEEECCCHHHHHHHHHHHHHHCHHHHHHHHHH AIKGSYAIVILTEDKLIGARDPHGIRPMCLGKIGDDYLLSSESCAFDCVGGEFIRDIEPG HHCCCEEEEEEECCCEECCCCCCCCCCCEECCCCCCCEECCCCCEEEECCCHHHHCCCCC EIVIIDESGINSIKFTEKTRCHTCAFEYIYFARPDSTMDGINVYESRIRAGRKLYEEYPV EEEEEECCCCCCEEECCCCCHHEEEEEEEEEECCCCCCCHHHHHHHHHHHHHHHHHHCCC EADIVIGVPDSGIPAAVGYAEASGIPYGIGFIKNKYVGRTFIAPSQELREKAVSVKLNPL CEEEEEECCCCCCCCEECCHHCCCCCEEHHHHHCCCCCEEECCCCHHHHHHHHEEEEEEE KINVEGKRVVIIDDSIVRGTTSKRLVQILRKAGAKEVHFRVSSPVVKYPCYFGIDTPYRK EEEECCCEEEEECCCCCCCCCHHHHHHHHHHCCCCEEEEEECCCEEECCEEECCCCCHHH DLIGAHSEVEEIREKIGADSLAYISMEGLVETLNKDKGFCLGCFNGVYPISAPIEMPKDS HHHCCHHHHHHHHHHHCCCCEEEEEHHHHHHHHCCCCCEEEEECCCCCCCCCCCCCCCCC LE CC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 6411717; 3036807; 9384377; 6411716; 6094545; 3090047; 8197456; 9271502 [H]