| Definition | Clostridium botulinum B str. Eklund 17B, complete genome. |
|---|---|
| Accession | NC_010674 |
| Length | 3,800,327 |
Click here to switch to the map view.
The map label for this gene is 187935427
Identifier: 187935427
GI number: 187935427
Start: 1990900
End: 1992291
Strand: Reverse
Name: 187935427
Synonym: CLL_A1896
Alternate gene names: NA
Gene position: 1992291-1990900 (Counterclockwise)
Preceding gene: 187934658
Following gene: 187934715
Centisome position: 52.42
GC content: 29.45
Gene sequence:
>1392_bases GTGGCAGAAAAATTTTATAGCATATTAACCAATATAGGAAAAGCTAAAGTTGCTAATTCTATAGGATTAGGCACTAAAGT AAACTTTTCAAAAATGAAAGTAGGAGATGGAGGTGGTAGTTACTATGAGCCTACAGAAAGCCAAACTGATTTAAAAAATG TTGTTTGGGAAGGAAATATAAATCATGTTACAGTTGATGAAGAAAATCCAAACTGGATTCACATAGAAGTTATGATTCCA AGTACAGTTGGAGGATTTACTATAAGAGAATATGGCGCTTTTGATGATGAAAATAATCTTATAGGAATATGTAAATGTGC TGAAACTTATAAGCCTGTAATAGCAGATGGAAGTACAAAAGAGCTCTTACTAGATTTAATACTATGTGTAGTTAATACAG ATACAGTAGAACTTAAAGTAGATCCAACTATTATCTTTGCTAAAAAAGGTGAAGTAGAACAATTAAGAACAGATATAAAT ATACAATTGAAAGATATTGCGAACGATAGTTATCCAATAGTAGAAGCAACAGGAACTAATATTTATGTTGGTTCTACAGC TAGAATAACTAAACTAAGCAAAGGTACAAGATGTACTTTGTTTGTTAATACAGATTCTAATGGTAATTGTAGTTTGAATT TAAACAATTATGGAGTAAAAAACATTAAAGACAGCTTTGGTAATATAGTTACTAATCTTAAATCTAATATTCCATATAAC TTATGTTATAATGGCTCGGATTTTATATTACAGGGTAAAGGAGGTGGTGGAAACCTAATTCCTAAATATCTATTACAAGG TTATTATGGAGATGGAGATAATGGACGAGTAGATGGTTCTATGGTTAACAGGGGTGCTCCAGTTGTAAATTTAAATTGTG GTGGAACATTTAATTTACAAGAAGGTTATTATAGTGGGGGACAGGCGATTGCTAATAATCTTGCAAGCCAAACAAGTGCA AATGCTACAGCATCTCAAATATTATCTGGATTTTCTGCTTGGGTAAATGGGAATAAAATAAATGGGAGTGCTACTATAGA GAGTTTAGGTGGGAAGAAATTTAAAAGTGGAACTTTGAATATATCTAATCTACAAACTAAGTCTTATAATGTAGTTAATT TAGAAAATAATACTCTTACTAATTCTACAAGAAATGTTAACGAAATTTCTTTAGAATTAGATTTCGTAGCAAAGTTTTTA ATTATACATTCTAATAGTTATACAAACTCAATTTCAGTAAAATTTAATGATATATGTATTGCTATTTATGATGAATCTAG TAGTGGATATGATAGGGTAAATTGTTATAGAGTAAATCAAAATAATAATACAATTCCTATAGATCTTTCAACTTATGCAA AAACATTTACTTATTATGCATTTGGAGATTAG
Upstream 100 bases:
>100_bases CACCTAATAATCTAGCTTATAAAGCAGATGTTAAAATCCCATTAATGCAGCCTAAAAGTTTCGAAAACATTAGAACATAT CCAGTAGAGGAGGGATTATA
Downstream 100 bases:
>100_bases AAAGGAGAGAATAATGTATGAAAATATTAACAGTATACAACAGCAAAGGACAACTTATATTTACACAAACTAATGCTATA GAACAATATAGTTGTTTGGT
Product: tail fiber protein
Products: NA
Alternate protein names: Phage Tail Fiber Protein; Tail Collar Domain Protein; Phage-Related Tail Fibre Protein-Like Protein; Tail Fiber Protein H; Variable Tail Fibre Protein; Tail Fiber-Related Protein; Phage Tail Collar Domain-Containing Protein; Phage Tail Collar Domain Protein; Phage Tail Fiber Protein H; Variable Tail Fiber Protein; Tail Fiber Domain Protein; Tail Fiber Domain-Containing Protein; Bacteriophage Tail Protein; Phage Tail Fibre Protein; Bacteriophage Variable Tail Fiber Protein H; Side Tail Phage Protein; Phage Variable Tail Fiber Protein; Phage Tail Fiber Domain Protein; Phage-Related Tail Fiber Protein-Like Protein; Tail Fiber Repeat 2 Protein; Phage Variable Tail Fibre Protein; Phage Tail Fiber-Like Protein; Phage P2 Tail Fiber GpH-Like Protein; Phage-Like Tail Fiber-Like Protein; Phage Tail-Like Protein; Bacteriophage Protein; Phage Tail Collar; E14 Prophage; Bacteriophage Variable Tail Fibre Protein; Prophage Tail Fiber Protein; Phage Protein GpH; Phage Protein; Phage-Like Tail Fibre Protein; Tail Fiber Repeat 2-Containing Protein; Tail Fiber Protein GpH
Number of amino acids: Translated: 463; Mature: 462
Protein sequence:
>463_residues MAEKFYSILTNIGKAKVANSIGLGTKVNFSKMKVGDGGGSYYEPTESQTDLKNVVWEGNINHVTVDEENPNWIHIEVMIP STVGGFTIREYGAFDDENNLIGICKCAETYKPVIADGSTKELLLDLILCVVNTDTVELKVDPTIIFAKKGEVEQLRTDIN IQLKDIANDSYPIVEATGTNIYVGSTARITKLSKGTRCTLFVNTDSNGNCSLNLNNYGVKNIKDSFGNIVTNLKSNIPYN LCYNGSDFILQGKGGGGNLIPKYLLQGYYGDGDNGRVDGSMVNRGAPVVNLNCGGTFNLQEGYYSGGQAIANNLASQTSA NATASQILSGFSAWVNGNKINGSATIESLGGKKFKSGTLNISNLQTKSYNVVNLENNTLTNSTRNVNEISLELDFVAKFL IIHSNSYTNSISVKFNDICIAIYDESSSGYDRVNCYRVNQNNNTIPIDLSTYAKTFTYYAFGD
Sequences:
>Translated_463_residues MAEKFYSILTNIGKAKVANSIGLGTKVNFSKMKVGDGGGSYYEPTESQTDLKNVVWEGNINHVTVDEENPNWIHIEVMIP STVGGFTIREYGAFDDENNLIGICKCAETYKPVIADGSTKELLLDLILCVVNTDTVELKVDPTIIFAKKGEVEQLRTDIN IQLKDIANDSYPIVEATGTNIYVGSTARITKLSKGTRCTLFVNTDSNGNCSLNLNNYGVKNIKDSFGNIVTNLKSNIPYN LCYNGSDFILQGKGGGGNLIPKYLLQGYYGDGDNGRVDGSMVNRGAPVVNLNCGGTFNLQEGYYSGGQAIANNLASQTSA NATASQILSGFSAWVNGNKINGSATIESLGGKKFKSGTLNISNLQTKSYNVVNLENNTLTNSTRNVNEISLELDFVAKFL IIHSNSYTNSISVKFNDICIAIYDESSSGYDRVNCYRVNQNNNTIPIDLSTYAKTFTYYAFGD >Mature_462_residues AEKFYSILTNIGKAKVANSIGLGTKVNFSKMKVGDGGGSYYEPTESQTDLKNVVWEGNINHVTVDEENPNWIHIEVMIPS TVGGFTIREYGAFDDENNLIGICKCAETYKPVIADGSTKELLLDLILCVVNTDTVELKVDPTIIFAKKGEVEQLRTDINI QLKDIANDSYPIVEATGTNIYVGSTARITKLSKGTRCTLFVNTDSNGNCSLNLNNYGVKNIKDSFGNIVTNLKSNIPYNL CYNGSDFILQGKGGGGNLIPKYLLQGYYGDGDNGRVDGSMVNRGAPVVNLNCGGTFNLQEGYYSGGQAIANNLASQTSAN ATASQILSGFSAWVNGNKINGSATIESLGGKKFKSGTLNISNLQTKSYNVVNLENNTLTNSTRNVNEISLELDFVAKFLI IHSNSYTNSISVKFNDICIAIYDESSSGYDRVNCYRVNQNNNTIPIDLSTYAKTFTYYAFGD
Specific function: Unknown
COG id: COG5301
COG function: function code R; Phage-related tail fibre protein
Gene ontology:
Cell location: Cytoplasmic
Metaboloic importance: NA
Operon status: Not Known
Operon components: None
Similarity: NA
Homologues:
None
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
NA
Pfam domain/function: NA
EC number: NA
Molecular weight: Translated: 50311; Mature: 50180
Theoretical pI: Translated: 5.01; Mature: 5.01
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.9 %Cys (Translated Protein) 0.9 %Met (Translated Protein) 2.8 %Cys+Met (Translated Protein) 1.9 %Cys (Mature Protein) 0.6 %Met (Mature Protein) 2.6 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MAEKFYSILTNIGKAKVANSIGLGTKVNFSKMKVGDGGGSYYEPTESQTDLKNVVWEGNI CCHHHHHHHHCCCHHHHHHHCCCCCEEEEEEEEECCCCCCCCCCCCCCCCHHHEEEECCC NHVTVDEENPNWIHIEVMIPSTVGGFTIREYGAFDDENNLIGICKCAETYKPVIADGSTK CEEEECCCCCCEEEEEEEECCCCCCEEEEECCCCCCCCCEEEEEEECCCCCCEEECCCHH ELLLDLILCVVNTDTVELKVDPTIIFAKKGEVEQLRTDINIQLKDIANDSYPIVEATGTN HHHHHHHHHHCCCCEEEEEECCEEEEECCCCHHHHHCCCCEEEEECCCCCCCEEEECCCE IYVGSTARITKLSKGTRCTLFVNTDSNGNCSLNLNNYGVKNIKDSFGNIVTNLKSNIPYN EEECCCEEEEEECCCCEEEEEEECCCCCEEEEEECCCCCCHHHHHHHHHHHHHHHCCCEE LCYNGSDFILQGKGGGGNLIPKYLLQGYYGDGDNGRVDGSMVNRGAPVVNLNCGGTFNLQ EEECCCEEEEEECCCCCCCCHHHHHCCCCCCCCCCEECCHHHCCCCCEEEEECCCEEECC EGYYSGGQAIANNLASQTSANATASQILSGFSAWVNGNKINGSATIESLGGKKFKSGTLN CCCCCCCHHHHHHHHHHCCCCHHHHHHHHHHHHHCCCCEECCCEEEECCCCCEECCCEEE ISNLQTKSYNVVNLENNTLTNSTRNVNEISLELDFVAKFLIIHSNSYTNSISVKFNDICI EEEEEECCEEEEEECCCEECCCCCCCEEEEEEHHHEEEEEEEECCCCCCEEEEEEEEEEE AIYDESSSGYDRVNCYRVNQNNNTIPIDLSTYAKTFTYYAFGD EEEECCCCCCCEEEEEEECCCCCEEEEEEHHCEEEEEEEEECC >Mature Secondary Structure AEKFYSILTNIGKAKVANSIGLGTKVNFSKMKVGDGGGSYYEPTESQTDLKNVVWEGNI CHHHHHHHHCCCHHHHHHHCCCCCEEEEEEEEECCCCCCCCCCCCCCCCHHHEEEECCC NHVTVDEENPNWIHIEVMIPSTVGGFTIREYGAFDDENNLIGICKCAETYKPVIADGSTK CEEEECCCCCCEEEEEEEECCCCCCEEEEECCCCCCCCCEEEEEEECCCCCCEEECCCHH ELLLDLILCVVNTDTVELKVDPTIIFAKKGEVEQLRTDINIQLKDIANDSYPIVEATGTN HHHHHHHHHHCCCCEEEEEECCEEEEECCCCHHHHHCCCCEEEEECCCCCCCEEEECCCE IYVGSTARITKLSKGTRCTLFVNTDSNGNCSLNLNNYGVKNIKDSFGNIVTNLKSNIPYN EEECCCEEEEEECCCCEEEEEEECCCCCEEEEEECCCCCCHHHHHHHHHHHHHHHCCCEE LCYNGSDFILQGKGGGGNLIPKYLLQGYYGDGDNGRVDGSMVNRGAPVVNLNCGGTFNLQ EEECCCEEEEEECCCCCCCCHHHHHCCCCCCCCCCEECCHHHCCCCCEEEEECCCEEECC EGYYSGGQAIANNLASQTSANATASQILSGFSAWVNGNKINGSATIESLGGKKFKSGTLN CCCCCCCHHHHHHHHHHCCCCHHHHHHHHHHHHHCCCCEECCCEEEECCCCCEECCCEEE ISNLQTKSYNVVNLENNTLTNSTRNVNEISLELDFVAKFLIIHSNSYTNSISVKFNDICI EEEEEECCEEEEEECCCEECCCCCCCEEEEEEHHHEEEEEEEECCCCCCEEEEEEEEEEE AIYDESSSGYDRVNCYRVNQNNNTIPIDLSTYAKTFTYYAFGD EEEECCCCCCCEEEEEEECCCCCEEEEEEHHCEEEEEEEEECC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: NA