Definition Clostridium botulinum A str. Hall, complete genome.
Accession NC_009698
Length 3,760,560

Click here to switch to the map view.

The map label for this gene is yhfX [C]

Identifier: 153935732

GI number: 153935732

Start: 2068052

End: 2069113

Strand: Reverse

Name: yhfX [C]

Synonym: CLC_1949

Alternate gene names: 153935732

Gene position: 2069113-2068052 (Counterclockwise)

Preceding gene: 153934534

Following gene: 153937367

Centisome position: 55.02

GC content: 27.87

Gene sequence:

>1062_bases
ATGTCTTATCCAAAGGTTGAAGTAGATACTAAAAAAATTAGATATAATACTAAGATTCTAGTAGAGGAATGTAAAAAAAG
AGGAATAAAAGTAGTGGCAGTAACTAAAACATTTTGTGGAAATCCTAAAATTGCAAAGGCTATTGCAGAAGAAAAAGTAG
ATATTCTAGCAGATTCCAGAATAGAAAATTTAAAAAAATTAGCTCATATTAATTTGCCTAAAATGCTTTTAAGATTACCT
ATGATAAGTCAGGTAGAGGAAGTAGTAAAATATGCAGATATTTCACTCGTATCAGATATTATTACTATAAGGGAACTTTC
TAAAGAGGCTATAAAACAAAATAAGATACATAGTATTATATTGATGATAGATTTAGGAGATCTAAGGGAAGGCATATTTA
ATGAAGAGGAGATTTATATTACGGTAAAAGAAATACTTAATTTTAAAAACGTAAAACTAATGGGTATAGGAACAAATTTG
TCCTGTTATGGTGGAGTCATTCCTACATATAAAAACTTATCACAGTTAGTTAATATAAAGAAAAATATAGAAAATAAGTT
CAATATAAAAATAGAGGTTATTTCAGGAGGAAATTCTGGATCTATTAGTTTATTTAAGGATAACAAAATACCACAAGAAA
TTAATCAATTAAGATTAGGAGCCTCTATATCTTTAGGGATAGGATTAAATGATGAACACATAGAACCTCTATTAAAAGAT
GCATTTAAGTTAGTAGTAGAGGTAGTGGAAGTGAAAAACAAGCCTTCAGTGCCTATTGGAATTATTGGATTAGATGCCTT
TGGTAATAAACCGTTTTTTGAGGATAAAGGTATTATGAAAAGAGCTATATGTGCTATAGGAAGGCAAAATATTAGTCCAG
AAAACCTAATACCCATAGATGATAATATATCAATTTTAGGGGCAAGTAGTGACCATCTTTTATTAGATATTACAAATTGT
AATAAGGATTATAAAATAGGTGATAAAATAGAATTTAATGTTACCTTTGGAGGATGTTTATCGGTAATGACATCTGAATA
TGTTTATAAAGTTATATTATAA

Upstream 100 bases:

>100_bases
TTTATAGGATTGCATTAAAAATTTGAAGAATGTATTATTATTATGTATAATAGTATAAAAATACAATAATAAAATATTAT
AAATTAGGCAGGTGCGTATA

Downstream 100 bases:

>100_bases
ATTTTTTAGTCATTCTTTTATATTTTTGTATTTTAACAAGAATATTATATGAAAAGAGTGACTTTTGTTTTCTATAGATA
ATGTTAGTATACTTGAAAAA

Product: alanine racemase domain-containing protein

Products: NA

Alternate protein names: Alanine Racemase Domain Protein; Alanine Racemase Domain-Containing Protein; Alanine Racemase N-Terminal Domain Family; Alanine Racemase N-Terminal Domain Protein; Alanine Racemase-Like Protein; Ornithine Racemase; Alanine Racemase N-Terminal

Number of amino acids: Translated: 353; Mature: 352

Protein sequence:

>353_residues
MSYPKVEVDTKKIRYNTKILVEECKKRGIKVVAVTKTFCGNPKIAKAIAEEKVDILADSRIENLKKLAHINLPKMLLRLP
MISQVEEVVKYADISLVSDIITIRELSKEAIKQNKIHSIILMIDLGDLREGIFNEEEIYITVKEILNFKNVKLMGIGTNL
SCYGGVIPTYKNLSQLVNIKKNIENKFNIKIEVISGGNSGSISLFKDNKIPQEINQLRLGASISLGIGLNDEHIEPLLKD
AFKLVVEVVEVKNKPSVPIGIIGLDAFGNKPFFEDKGIMKRAICAIGRQNISPENLIPIDDNISILGASSDHLLLDITNC
NKDYKIGDKIEFNVTFGGCLSVMTSEYVYKVIL

Sequences:

>Translated_353_residues
MSYPKVEVDTKKIRYNTKILVEECKKRGIKVVAVTKTFCGNPKIAKAIAEEKVDILADSRIENLKKLAHINLPKMLLRLP
MISQVEEVVKYADISLVSDIITIRELSKEAIKQNKIHSIILMIDLGDLREGIFNEEEIYITVKEILNFKNVKLMGIGTNL
SCYGGVIPTYKNLSQLVNIKKNIENKFNIKIEVISGGNSGSISLFKDNKIPQEINQLRLGASISLGIGLNDEHIEPLLKD
AFKLVVEVVEVKNKPSVPIGIIGLDAFGNKPFFEDKGIMKRAICAIGRQNISPENLIPIDDNISILGASSDHLLLDITNC
NKDYKIGDKIEFNVTFGGCLSVMTSEYVYKVIL
>Mature_352_residues
SYPKVEVDTKKIRYNTKILVEECKKRGIKVVAVTKTFCGNPKIAKAIAEEKVDILADSRIENLKKLAHINLPKMLLRLPM
ISQVEEVVKYADISLVSDIITIRELSKEAIKQNKIHSIILMIDLGDLREGIFNEEEIYITVKEILNFKNVKLMGIGTNLS
CYGGVIPTYKNLSQLVNIKKNIENKFNIKIEVISGGNSGSISLFKDNKIPQEINQLRLGASISLGIGLNDEHIEPLLKDA
FKLVVEVVEVKNKPSVPIGIIGLDAFGNKPFFEDKGIMKRAICAIGRQNISPENLIPIDDNISILGASSDHLLLDITNCN
KDYKIGDKIEFNVTFGGCLSVMTSEYVYKVIL

Specific function: Unknown

COG id: COG3457

COG function: function code E; Predicted amino acid racemase

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 39344; Mature: 39213

Theoretical pI: Translated: 8.54; Mature: 8.54

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.7 %Cys     (Translated Protein)
2.0 %Met     (Translated Protein)
3.7 %Cys+Met (Translated Protein)
1.7 %Cys     (Mature Protein)
1.7 %Met     (Mature Protein)
3.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSYPKVEVDTKKIRYNTKILVEECKKRGIKVVAVTKTFCGNPKIAKAIAEEKVDILADSR
CCCCCEEECHHEEEECHHHHHHHHHHCCCEEEEEEEECCCCCHHHHHHHHHHHHHHHHHH
IENLKKLAHINLPKMLLRLPMISQVEEVVKYADISLVSDIITIRELSKEAIKQNKIHSII
HHHHHHHHHCCHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEE
LMIDLGDLREGIFNEEEIYITVKEILNFKNVKLMGIGTNLSCYGGVIPTYKNLSQLVNIK
EEEECCHHHHCCCCCCEEEEEHHHHCCCCCEEEEEECCCCCCCCCCCCCHHHHHHHHHHH
KNIENKFNIKIEVISGGNSGSISLFKDNKIPQEINQLRLGASISLGIGLNDEHIEPLLKD
HCCCCEEEEEEEEEECCCCCEEEEEECCCCHHHHHHHHCCCEEEEECCCCHHHHHHHHHH
AFKLVVEVVEVKNKPSVPIGIIGLDAFGNKPFFEDKGIMKRAICAIGRQNISPENLIPID
HHHHHHHHHHHCCCCCCCEEEEEEECCCCCCCCCCCHHHHHHHHHHCCCCCCCCCEEECC
DNISILGASSDHLLLDITNCNKDYKIGDKIEFNVTFGGCLSVMTSEYVYKVIL
CCEEEEECCCCEEEEEEECCCCCCCCCCEEEEEEEHHHHHHHHHHHHHHEECC
>Mature Secondary Structure 
SYPKVEVDTKKIRYNTKILVEECKKRGIKVVAVTKTFCGNPKIAKAIAEEKVDILADSR
CCCCEEECHHEEEECHHHHHHHHHHCCCEEEEEEEECCCCCHHHHHHHHHHHHHHHHHH
IENLKKLAHINLPKMLLRLPMISQVEEVVKYADISLVSDIITIRELSKEAIKQNKIHSII
HHHHHHHHHCCHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEE
LMIDLGDLREGIFNEEEIYITVKEILNFKNVKLMGIGTNLSCYGGVIPTYKNLSQLVNIK
EEEECCHHHHCCCCCCEEEEEHHHHCCCCCEEEEEECCCCCCCCCCCCCHHHHHHHHHHH
KNIENKFNIKIEVISGGNSGSISLFKDNKIPQEINQLRLGASISLGIGLNDEHIEPLLKD
HCCCCEEEEEEEEEECCCCCEEEEEECCCCHHHHHHHHCCCEEEEECCCCHHHHHHHHHH
AFKLVVEVVEVKNKPSVPIGIIGLDAFGNKPFFEDKGIMKRAICAIGRQNISPENLIPID
HHHHHHHHHHHCCCCCCCEEEEEEECCCCCCCCCCCHHHHHHHHHHCCCCCCCCCEEECC
DNISILGASSDHLLLDITNCNKDYKIGDKIEFNVTFGGCLSVMTSEYVYKVIL
CCEEEEECCCCEEEEEEECCCCCCCCCCEEEEEEEHHHHHHHHHHHHHHEECC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: NA