Definition Bacillus anthracis str. Sterne chromosome, complete genome.
Accession NC_005945
Length 5,228,663

Click here to switch to the map view.

The map label for this gene is 49186559

Identifier: 49186559

GI number: 49186559

Start: 3515305

End: 3516750

Strand: Direct

Name: 49186559

Synonym: BAS3557

Alternate gene names: NA

Gene position: 3515305-3516750 (Clockwise)

Preceding gene: 49186558

Following gene: 49186562

Centisome position: 67.23

GC content: 45.37

Gene sequence:

>1446_bases
ATGTCTCGTTATGACGACAGTCAAAACAAATTCTCCAAACCATGCTTTCCAAGTAGCGCTGGACGAATCCCGAATACTCC
ATCAATCCCAGTTACTAAGGCACAACTTAGAACATTTCGCGCAATCATTATTGATTTAACAAAAATAATCCCAAAACTTT
TCGCAAATCCATCTCCCCAAAATATTGAAGATCTAATCGATACATTGAACCTACTAAGTAAATTTATTTGTTCACTAGAC
GCTGCTTCCTCCCTGAAAGCACAAGGATTAGCTATTATTAAAAACTTAATAACTATATTAAAAAACCCAACTTTCGTAGC
AAGTGCTGTATTTATCGAGCTTCAAAATCTAATTAATTATTTACTATCCATTACAAAACTATTCCGAATTGACCCTTGCA
CACTTCAAGAGCTTCTTAAATTAATAGCAGCATTACAAACCGCTTTAGTTAATTCTGCTTCATTCATTCAAGGACCTACT
GGACCTACTGGACCTACTGGACCTACTGGGCCAGCTGGTGCTACCGGTGCTACTGGACCTCAAGGTGTTCAAGGACCAGC
AGGCGCTACCGGTGCCACTGGACCTCAAGGTGTTCAAGGACCAGCAGGTGCTACTGGCGCTACTGGACCTCAAGGTGCTC
AAGGACCAGCAGGTGCTACCGGTGCTACTGGACCTCAAGGTGCTCAAGGACCAGCAGGTGCTACTGGTGCCACTGGACCT
CAAGGTATTCAAGGACCAGCAGGTGCTACCGGTGCTACTGGACCTCAAGGCGTTCAAGGGCCAACGGGTGCTACTGGTAT
AGGAGTTACCGGACCTACTGGGCCTTCTGGTGGGCCTGCTGGTGCTACTGGACCTCAGGGACCTCAAGGTAATACAGGTG
CTACTGGACCTCAAGGTATTCAAGGGCCTGCTGGTGCTACTGGTGCCACTGGACCTCAAGGTGCTCAAGGACCGGCTGGT
GCTACCGGCGCTACTGGACCTCAAGGTGTTCAAGGGCCAACGGGTGCTACTGGTATAGGAGTTACCGGACCTACTGGGCC
TTCTGGACCTAGCTTCCCTGTAGCAACAATTGTTGTAACAAACAACATTCAACAAACAGTACTCCAATTTAACAACTTCA
TTTTTAATACTGCAATTAACGTAAACAACATTATCTTCAACGGCACAGATACAGTTACTGTTATCAACGCTGGTATTTAT
GTCATTAGCGTATCCATCTCTACAACTGCACCAGGATGTGCACCACTCGGAGTAGGAATTTCAATAAATGGAGCAGTCGC
AACTGACAACTTCTCTTCAAATCTAATAGGCGACTCACTTTCATTCACTACGATCGAAACGTTAACTGCCGGCGCGAACA
TTTCTGTCCAATCCACTCTTAATGAGATTACGATCCCTGCAACAGGAAACACTAATATTCGTCTAACTGTATTTAGAATC
GCTTAA

Upstream 100 bases:

>100_bases
TTTTTTCTTCAAACAAACGATTTTACTATGACCATTTAACTAATTTTTGCATCTACTATGATGAGTTTCATTCACATTCT
CATTAGAAAGGAGAGATTTA

Downstream 100 bases:

>100_bases
ATTTCACTATTTATTTTTTATAACAAATAAAAAAAGAGCGAGAAACTCGCTCTTTTTTTGTTATGTACAATAATTCATTA
CTACTCTAATTCAATTGAAA

Product: hypothetical protein

Products: NA

Alternate protein names: Collagen Triple Helix Repeat Protein; Group-Specific Protein; Collagen Triple Helix Repeat Domain-Containing Protein; Collagen-Like Protein

Number of amino acids: Translated: 481; Mature: 480

Protein sequence:

>481_residues
MSRYDDSQNKFSKPCFPSSAGRIPNTPSIPVTKAQLRTFRAIIIDLTKIIPKLFANPSPQNIEDLIDTLNLLSKFICSLD
AASSLKAQGLAIIKNLITILKNPTFVASAVFIELQNLINYLLSITKLFRIDPCTLQELLKLIAALQTALVNSASFIQGPT
GPTGPTGPTGPAGATGATGPQGVQGPAGATGATGPQGVQGPAGATGATGPQGAQGPAGATGATGPQGAQGPAGATGATGP
QGIQGPAGATGATGPQGVQGPTGATGIGVTGPTGPSGGPAGATGPQGPQGNTGATGPQGIQGPAGATGATGPQGAQGPAG
ATGATGPQGVQGPTGATGIGVTGPTGPSGPSFPVATIVVTNNIQQTVLQFNNFIFNTAINVNNIIFNGTDTVTVINAGIY
VISVSISTTAPGCAPLGVGISINGAVATDNFSSNLIGDSLSFTTIETLTAGANISVQSTLNEITIPATGNTNIRLTVFRI
A

Sequences:

>Translated_481_residues
MSRYDDSQNKFSKPCFPSSAGRIPNTPSIPVTKAQLRTFRAIIIDLTKIIPKLFANPSPQNIEDLIDTLNLLSKFICSLD
AASSLKAQGLAIIKNLITILKNPTFVASAVFIELQNLINYLLSITKLFRIDPCTLQELLKLIAALQTALVNSASFIQGPT
GPTGPTGPTGPAGATGATGPQGVQGPAGATGATGPQGVQGPAGATGATGPQGAQGPAGATGATGPQGAQGPAGATGATGP
QGIQGPAGATGATGPQGVQGPTGATGIGVTGPTGPSGGPAGATGPQGPQGNTGATGPQGIQGPAGATGATGPQGAQGPAG
ATGATGPQGVQGPTGATGIGVTGPTGPSGPSFPVATIVVTNNIQQTVLQFNNFIFNTAINVNNIIFNGTDTVTVINAGIY
VISVSISTTAPGCAPLGVGISINGAVATDNFSSNLIGDSLSFTTIETLTAGANISVQSTLNEITIPATGNTNIRLTVFRI
A
>Mature_480_residues
SRYDDSQNKFSKPCFPSSAGRIPNTPSIPVTKAQLRTFRAIIIDLTKIIPKLFANPSPQNIEDLIDTLNLLSKFICSLDA
ASSLKAQGLAIIKNLITILKNPTFVASAVFIELQNLINYLLSITKLFRIDPCTLQELLKLIAALQTALVNSASFIQGPTG
PTGPTGPTGPAGATGATGPQGVQGPAGATGATGPQGVQGPAGATGATGPQGAQGPAGATGATGPQGAQGPAGATGATGPQ
GIQGPAGATGATGPQGVQGPTGATGIGVTGPTGPSGGPAGATGPQGPQGNTGATGPQGIQGPAGATGATGPQGAQGPAGA
TGATGPQGVQGPTGATGIGVTGPTGPSGPSFPVATIVVTNNIQQTVLQFNNFIFNTAINVNNIIFNGTDTVTVINAGIYV
ISVSISTTAPGCAPLGVGISINGAVATDNFSSNLIGDSLSFTTIETLTAGANISVQSTLNEITIPATGNTNIRLTVFRIA

Specific function: Unknown

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

Organism=Homo sapiens, GI183583553, Length=245, Percent_Identity=34.6938775510204, Blast_Score=115, Evalue=1e-25,
Organism=Homo sapiens, GI156616290, Length=255, Percent_Identity=31.7647058823529, Blast_Score=103, Evalue=5e-22,
Organism=Homo sapiens, GI56847616, Length=238, Percent_Identity=35.2941176470588, Blast_Score=99, Evalue=8e-21,
Organism=Homo sapiens, GI65301115, Length=238, Percent_Identity=34.8739495798319, Blast_Score=98, Evalue=2e-20,
Organism=Homo sapiens, GI5803080, Length=260, Percent_Identity=37.3076923076923, Blast_Score=96, Evalue=5e-20,
Organism=Homo sapiens, GI115527062, Length=257, Percent_Identity=33.4630350194552, Blast_Score=87, Evalue=4e-17,
Organism=Homo sapiens, GI115527066, Length=268, Percent_Identity=32.4626865671642, Blast_Score=86, Evalue=8e-17,
Organism=Homo sapiens, GI115392133, Length=209, Percent_Identity=40.1913875598086, Blast_Score=86, Evalue=1e-16,
Organism=Homo sapiens, GI115527070, Length=268, Percent_Identity=32.4626865671642, Blast_Score=86, Evalue=1e-16,
Organism=Homo sapiens, GI18780273, Length=201, Percent_Identity=39.8009950248756, Blast_Score=84, Evalue=4e-16,
Organism=Homo sapiens, GI119829187, Length=251, Percent_Identity=35.0597609561753, Blast_Score=82, Evalue=2e-15,
Organism=Homo sapiens, GI55743098, Length=353, Percent_Identity=28.8951841359773, Blast_Score=81, Evalue=2e-15,
Organism=Homo sapiens, GI240255535, Length=353, Percent_Identity=28.8951841359773, Blast_Score=81, Evalue=2e-15,
Organism=Homo sapiens, GI55743106, Length=353, Percent_Identity=28.8951841359773, Blast_Score=81, Evalue=2e-15,
Organism=Homo sapiens, GI111118976, Length=198, Percent_Identity=43.4343434343434, Blast_Score=81, Evalue=3e-15,
Organism=Homo sapiens, GI122937273, Length=351, Percent_Identity=29.6296296296296, Blast_Score=80, Evalue=3e-15,
Organism=Homo sapiens, GI32140760, Length=207, Percent_Identity=40.5797101449275, Blast_Score=78, Evalue=1e-14,
Organism=Homo sapiens, GI111118974, Length=198, Percent_Identity=43.4343434343434, Blast_Score=78, Evalue=2e-14,
Organism=Homo sapiens, GI111118970, Length=256, Percent_Identity=35.15625, Blast_Score=78, Evalue=2e-14,
Organism=Homo sapiens, GI111118968, Length=256, Percent_Identity=35.15625, Blast_Score=77, Evalue=3e-14,
Organism=Homo sapiens, GI111118972, Length=256, Percent_Identity=35.15625, Blast_Score=77, Evalue=4e-14,
Organism=Homo sapiens, GI73486666, Length=198, Percent_Identity=42.4242424242424, Blast_Score=76, Evalue=6e-14,
Organism=Homo sapiens, GI89363017, Length=270, Percent_Identity=36.6666666666667, Blast_Score=75, Evalue=1e-13,
Organism=Homo sapiens, GI48762934, Length=204, Percent_Identity=42.156862745098, Blast_Score=74, Evalue=2e-13,
Organism=Homo sapiens, GI110735435, Length=171, Percent_Identity=42.1052631578947, Blast_Score=74, Evalue=4e-13,
Organism=Homo sapiens, GI40805823, Length=240, Percent_Identity=37.9166666666667, Blast_Score=72, Evalue=9e-13,
Organism=Homo sapiens, GI87196339, Length=201, Percent_Identity=34.3283582089552, Blast_Score=71, Evalue=3e-12,
Organism=Homo sapiens, GI11386161, Length=177, Percent_Identity=45.7627118644068, Blast_Score=70, Evalue=4e-12,
Organism=Homo sapiens, GI98985806, Length=145, Percent_Identity=38.6206896551724, Blast_Score=68, Evalue=2e-11,
Organism=Homo sapiens, GI98985810, Length=145, Percent_Identity=38.6206896551724, Blast_Score=68, Evalue=2e-11,
Organism=Homo sapiens, GI299523257, Length=145, Percent_Identity=38.6206896551724, Blast_Score=67, Evalue=3e-11,
Organism=Homo sapiens, GI299523253, Length=145, Percent_Identity=40, Blast_Score=67, Evalue=5e-11,
Organism=Homo sapiens, GI154759255, Length=238, Percent_Identity=36.5546218487395, Blast_Score=66, Evalue=6e-11,
Organism=Caenorhabditis elegans, GI17539078, Length=272, Percent_Identity=31.25, Blast_Score=75, Evalue=7e-14,
Organism=Caenorhabditis elegans, GI17535735, Length=183, Percent_Identity=40.4371584699454, Blast_Score=74, Evalue=1e-13,
Organism=Caenorhabditis elegans, GI17507107, Length=256, Percent_Identity=33.984375, Blast_Score=70, Evalue=2e-12,
Organism=Caenorhabditis elegans, GI71992048, Length=199, Percent_Identity=40.7035175879397, Blast_Score=70, Evalue=3e-12,
Organism=Caenorhabditis elegans, GI17566918, Length=173, Percent_Identity=40.4624277456647, Blast_Score=69, Evalue=8e-12,
Organism=Caenorhabditis elegans, GI193203538, Length=206, Percent_Identity=34.9514563106796, Blast_Score=67, Evalue=1e-11,
Organism=Caenorhabditis elegans, GI17569903, Length=228, Percent_Identity=35.9649122807018, Blast_Score=67, Evalue=2e-11,
Organism=Drosophila melanogaster, GI17137252, Length=237, Percent_Identity=36.7088607594937, Blast_Score=68, Evalue=1e-11,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 47008; Mature: 46877

Theoretical pI: Translated: 8.63; Mature: 8.63

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.8 %Cys     (Translated Protein)
0.2 %Met     (Translated Protein)
1.0 %Cys+Met (Translated Protein)
0.8 %Cys     (Mature Protein)
0.0 %Met     (Mature Protein)
0.8 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSRYDDSQNKFSKPCFPSSAGRIPNTPSIPVTKAQLRTFRAIIIDLTKIIPKLFANPSPQ
CCCCCCCHHHCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCC
NIEDLIDTLNLLSKFICSLDAASSLKAQGLAIIKNLITILKNPTFVASAVFIELQNLINY
CHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHH
LLSITKLFRIDPCTLQELLKLIAALQTALVNSASFIQGPTGPTGPTGPTGPAGATGATGP
HHHHHHHHCCCCHHHHHHHHHHHHHHHHHHCCHHHHCCCCCCCCCCCCCCCCCCCCCCCC
QGVQGPAGATGATGPQGVQGPAGATGATGPQGAQGPAGATGATGPQGAQGPAGATGATGP
CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC
QGIQGPAGATGATGPQGVQGPTGATGIGVTGPTGPSGGPAGATGPQGPQGNTGATGPQGI
CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC
QGPAGATGATGPQGAQGPAGATGATGPQGVQGPTGATGIGVTGPTGPSGPSFPVATIVVT
CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCEEEEEEE
NNIQQTVLQFNNFIFNTAINVNNIIFNGTDTVTVINAGIYVISVSISTTAPGCAPLGVGI
CCHHHHHHHHHHEEEEEEEEECCEEECCCCEEEEEECCEEEEEEEEECCCCCCCEEECCE
SINGAVATDNFSSNLIGDSLSFTTIETLTAGANISVQSTLNEITIPATGNTNIRLTVFRI
EECCEEEECCCCCCCCCCCCCCEEHHHHHCCCCEEEEECCCEEEECCCCCCCEEEEEEEE
A
C
>Mature Secondary Structure 
SRYDDSQNKFSKPCFPSSAGRIPNTPSIPVTKAQLRTFRAIIIDLTKIIPKLFANPSPQ
CCCCCCHHHCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCC
NIEDLIDTLNLLSKFICSLDAASSLKAQGLAIIKNLITILKNPTFVASAVFIELQNLINY
CHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHH
LLSITKLFRIDPCTLQELLKLIAALQTALVNSASFIQGPTGPTGPTGPTGPAGATGATGP
HHHHHHHHCCCCHHHHHHHHHHHHHHHHHHCCHHHHCCCCCCCCCCCCCCCCCCCCCCCC
QGVQGPAGATGATGPQGVQGPAGATGATGPQGAQGPAGATGATGPQGAQGPAGATGATGP
CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC
QGIQGPAGATGATGPQGVQGPTGATGIGVTGPTGPSGGPAGATGPQGPQGNTGATGPQGI
CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC
QGPAGATGATGPQGAQGPAGATGATGPQGVQGPTGATGIGVTGPTGPSGPSFPVATIVVT
CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCEEEEEEE
NNIQQTVLQFNNFIFNTAINVNNIIFNGTDTVTVINAGIYVISVSISTTAPGCAPLGVGI
CCHHHHHHHHHHEEEEEEEEECCEEECCCCEEEEEECCEEEEEEEEECCCCCCCEEECCE
SINGAVATDNFSSNLIGDSLSFTTIETLTAGANISVQSTLNEITIPATGNTNIRLTVFRI
EECCEEEECCCCCCCCCCCCCCEEHHHHHCCCCEEEEECCCEEEECCCCCCCEEEEEEEE
A
C

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA