Definition Clostridium botulinum A2 str. Kyoto chromosome, complete genome.
Accession NC_012563
Length 4,155,278

Click here to switch to the map view.

The map label for this gene is gufA [H]

Identifier: 226948444

GI number: 226948444

Start: 1388537

End: 1389346

Strand: Direct

Name: gufA [H]

Synonym: CLM_1328

Alternate gene names: 226948444

Gene position: 1388537-1389346 (Clockwise)

Preceding gene: 226948443

Following gene: 226948445

Centisome position: 33.42

GC content: 37.16

Gene sequence:

>810_bases
ATGACTTGGTTTAAAGAATTGAATCCCATTATGCAGGCTCTTTTAGCTACATTATTTACCTGGGCAGTTACAGCTTTAGG
AGCAGCATTAGTGTTTTTTTTTAAAAATATAAATAAAAAAGTATTAAATGCTATGTTAGGTTTTGCAGCAGGAGTAATGA
TTGCGGCTAGCTATTGGTCACTTTTAGCACCGGCTATAGAAATGGCAGAATCCCAGGGCAAAATTGCATGGATACCGGCA
GCAGTAGGTTTTTTAGCAGGAGGAATATTTTTAAGAATAGTAGATAGAATTCTTCCACACCTTCATTTAGGTAAAGATAG
AGATGAGGCGGAGGGAATTAAAACTAGTTGGCAAAAGAGCATATTATTAGTTTTAGCTATAACCCTTCATAACATACCAG
AAGGATTAGCTGTAGGAGTGGCCTTTGGAGCAGTAGGGGCCAATATAGAGTCTGCATCTTTAGCAGGAGCTATAGCTTTA
GCATTAGGTATAGGAATTCAAAACTTTCCTGAAGGAGCAGCAGTATCTATACCACTAAGAAGAGAAGGAAATAGTAGATT
AAAAAGTTTTTGGTATGGGCAAGCTTCTGGTATAGTTGAACCTATAGCAGGTGTTATAGGGGCAGCGGCAGTATTATTTA
TAAGAAATTTATTACCCTATGCCTTATCCTTTGCAGCTGGAGCCATGATATTTGTTGTAGTAGAGGAACTAATTCCTGAA
GCCCAGGAAGGAAAGGATACAGATATATCATCTATAGGAGTATTAATTGGATTTACTGTAATGATGATATTAGATGTAGC
TTTAGGCTAA

Upstream 100 bases:

>100_bases
TAAATATTGATTATATTGATAGTACGTGATAAAATCAAAATAAGAAATTATCAAGTAATAATTATTATCGTTTATTCAGA
ACTAGAAAGAAGGGGAGAGT

Downstream 100 bases:

>100_bases
ACAGAGTTCTTGGCTTCAGAGGGAGTTTTTACTCACTCTGAAGCTTATTAACAAAATTCTTAGGAGTTTTACTCCTTAGA
AGTCGTTATCCTTTAGGGGA

Product: ZIP family zinc transporter

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 269; Mature: 268

Protein sequence:

>269_residues
MTWFKELNPIMQALLATLFTWAVTALGAALVFFFKNINKKVLNAMLGFAAGVMIAASYWSLLAPAIEMAESQGKIAWIPA
AVGFLAGGIFLRIVDRILPHLHLGKDRDEAEGIKTSWQKSILLVLAITLHNIPEGLAVGVAFGAVGANIESASLAGAIAL
ALGIGIQNFPEGAAVSIPLRREGNSRLKSFWYGQASGIVEPIAGVIGAAAVLFIRNLLPYALSFAAGAMIFVVVEELIPE
AQEGKDTDISSIGVLIGFTVMMILDVALG

Sequences:

>Translated_269_residues
MTWFKELNPIMQALLATLFTWAVTALGAALVFFFKNINKKVLNAMLGFAAGVMIAASYWSLLAPAIEMAESQGKIAWIPA
AVGFLAGGIFLRIVDRILPHLHLGKDRDEAEGIKTSWQKSILLVLAITLHNIPEGLAVGVAFGAVGANIESASLAGAIAL
ALGIGIQNFPEGAAVSIPLRREGNSRLKSFWYGQASGIVEPIAGVIGAAAVLFIRNLLPYALSFAAGAMIFVVVEELIPE
AQEGKDTDISSIGVLIGFTVMMILDVALG
>Mature_268_residues
TWFKELNPIMQALLATLFTWAVTALGAALVFFFKNINKKVLNAMLGFAAGVMIAASYWSLLAPAIEMAESQGKIAWIPAA
VGFLAGGIFLRIVDRILPHLHLGKDRDEAEGIKTSWQKSILLVLAITLHNIPEGLAVGVAFGAVGANIESASLAGAIALA
LGIGIQNFPEGAAVSIPLRREGNSRLKSFWYGQASGIVEPIAGVIGAAAVLFIRNLLPYALSFAAGAMIFVVVEELIPEA
QEGKDTDISSIGVLIGFTVMMILDVALG

Specific function: Mediates Zinc Uptake. May Also Transport Other Divalent Cations Such As Copper And Cadmium Ions. [C]

COG id: COG0428

COG function: function code P; Predicted divalent heavy-metal cations transporter

Gene ontology:

Cell location: Cell inner membrane; Multi-pass membrane protein [H]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

Organism=Homo sapiens, GI229577418, Length=329, Percent_Identity=42.5531914893617, Blast_Score=220, Evalue=1e-57,
Organism=Homo sapiens, GI229577422, Length=335, Percent_Identity=39.4029850746269, Blast_Score=190, Evalue=1e-48,
Organism=Escherichia coli, GI1789419, Length=259, Percent_Identity=30.1158301158301, Blast_Score=84, Evalue=1e-17,
Organism=Caenorhabditis elegans, GI17507805, Length=320, Percent_Identity=47.8125, Blast_Score=276, Evalue=6e-75,
Organism=Drosophila melanogaster, GI24652846, Length=164, Percent_Identity=54.2682926829268, Blast_Score=175, Evalue=2e-44,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR003689 [H]

Pfam domain/function: PF02535 Zip [H]

EC number: NA

Molecular weight: Translated: 28373; Mature: 28242

Theoretical pI: Translated: 5.72; Mature: 5.72

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.0 %Cys     (Translated Protein)
3.0 %Met     (Translated Protein)
3.0 %Cys+Met (Translated Protein)
0.0 %Cys     (Mature Protein)
2.6 %Met     (Mature Protein)
2.6 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MTWFKELNPIMQALLATLFTWAVTALGAALVFFFKNINKKVLNAMLGFAAGVMIAASYWS
CCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
LLAPAIEMAESQGKIAWIPAAVGFLAGGIFLRIVDRILPHLHLGKDRDEAEGIKTSWQKS
HHHHHHHHHHCCCCEEEHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHH
ILLVLAITLHNIPEGLAVGVAFGAVGANIESASLAGAIALALGIGIQNFPEGAAVSIPLR
HHHHHHHHHHCCCCHHHHHHHHHHHCCCCCHHHHHHHHHHHHHCCCCCCCCCCEEEEEEC
REGNSRLKSFWYGQASGIVEPIAGVIGAAAVLFIRNLLPYALSFAAGAMIFVVVEELIPE
CCCCHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCC
AQEGKDTDISSIGVLIGFTVMMILDVALG
CCCCCCCCHHHHHHHHHHHHHHHHHHHCC
>Mature Secondary Structure 
TWFKELNPIMQALLATLFTWAVTALGAALVFFFKNINKKVLNAMLGFAAGVMIAASYWS
CHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
LLAPAIEMAESQGKIAWIPAAVGFLAGGIFLRIVDRILPHLHLGKDRDEAEGIKTSWQKS
HHHHHHHHHHCCCCEEEHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHH
ILLVLAITLHNIPEGLAVGVAFGAVGANIESASLAGAIALALGIGIQNFPEGAAVSIPLR
HHHHHHHHHHCCCCHHHHHHHHHHHCCCCCHHHHHHHHHHHHHCCCCCCCCCCEEEEEEC
REGNSRLKSFWYGQASGIVEPIAGVIGAAAVLFIRNLLPYALSFAAGAMIFVVVEELIPE
CCCCHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCC
AQEGKDTDISSIGVLIGFTVMMILDVALG
CCCCCCCCHHHHHHHHHHHHHHHHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Alpha

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 7.0

TargetDB status: NA

Availability: NA

References: 7934835 [H]