The gene/protein map for NC_006351 is currently unavailable.
Definition Burkholderia pseudomallei K96243 chromosome 2, complete sequence.
Accession NC_006351
Length 3,173,005

Click here to switch to the map view.

The map label for this gene is bipB

Identifier: 53722553

GI number: 53722553

Start: 2085560

End: 2087422

Strand: Reverse

Name: bipB

Synonym: BPSS1532

Alternate gene names: 53722553

Gene position: 2087422-2085560 (Counterclockwise)

Preceding gene: 53722554

Following gene: 53722552

Centisome position: 65.79

GC content: 69.89

Gene sequence:

>1863_bases
ATGTCATCGGGAGTGCAGGGCGGACCGGCCGCCAACGCGAACGCTTACCAGACCCATCCGCTGCGCGACGCGGCGAGCGC
GCTCGGCACGCTGTCGCCGCAGGCGTACGTCGACGTGGTGTCGGCCGCGCAGCGCAATTTTCTCGAGCGGATGTCGCAGC
TCGCCTCCGAGCAGTGCGACGCGCAGCCGGCGGCGCACGACGCGCGGCTCGACGACAGGCCGGCGCTGCGCGCGCCGCAG
GAGCGCGATGCGCCGCCGTTGGGCGCGTCGGACACGGGCAGCCGCGCGAGCGGCGCGGCGAAGCTGACCGAATTGCTCGG
CGTGCTGATGAGCGTCATCAGCGCGAGCAGTCTCGACGAGCTCAAGCAGCGCTCGGACATCTGGAACCAGATGTCGAAGG
CCGCGCAGGACAACCTGAGCCGGCTGTCCGACGCGTTCCAGCGCGCGACCGACGAAGCGAAGGCGGCGGCCGACGCGGCC
GAGCAGGCCGCCGCCGCGGCGAAGCAGGCGGGCGCCGACGCGAAGGCCGCGGATGCGGCCGTCGACGCCGCGCAGAAGCG
GTACGACGACGCGGTGAAGCAGGGCCTGCCCGACGATCGGTTGCAGAGCCTGAAGGCGGCGCTCGAGCAGGCCAGGCAGC
AGGCGGGCGACGCGCACGGCCGGGCGGACGCGTTGCAGGCGGACGCGACGAAGAAGCTCGATGCGGCGAGCGCGCTCGCG
ACGCAGGCGCGCGCATGCGAGCAGCAGGTCGACGACGCGGTGAACCAGGCCACGCAGCAGTACGGCGCGAGTGCCTCGTT
GCGCACGCCGCAGTCGCCGAGGCTGAGCGGCGCGGCCGAGCTCACGGCCGTGCTCGGCAAGCTGCAGGAGCTGATCTCGT
CGGGCAACGTGAAGGAGCTCGAATCGAAGCAGAAGCTCTTCACCGAGATGCAGGCGAAGCGCGAGGCCGAACTGCAAAAG
AAGTCCGACGAGTATCAGGCCCAGGTGAAGAAGGCCGAGGAGATGCAGAAGACGATGGGCTGCATCGGCAAGATCGTCGG
CTGGGTGATCACCGCGGTCAGCTTCGCGGCGGCCGCGTTCACGGGCGGCGCGAGCCTCGCGCTCGCGGCCGTGGGGCTCG
CGCTCGCGGTCGGCGACGAGATCAGCCGCGCGACGACGGGCGTGTCGTTCATGGACAAGCTGATGCAGCCCGTGATGGAC
GCGATCCTCAAGCCGCTGATGGAGATGATCTCGTCGCTCATCACGAAGGCGCTCGTCGCGTGCGGCGTCGATCAGCAGAA
GGCCGAGCTCGCCGGCGCGATCCTCGGCGCGGTCGTGACGGGCGTCGCGCTCGTCGCGGCCGCGTTCGTCGGCGCATCGG
CGGTGAAGGCGGTCGCCTCGAAGGTGATCGACGCGATGGCCGGCCAACTGACGAAGCTGATGGATTCGGCGATCGGCAAG
ATGCTCGTGCAACTGATCGAGAAGTTCTCCGAGAAGTCGGGGCTGCAGGCGCTCGGCTCGCGCACCGCGACCGCGATGAC
GCGGATGCGCCGCGCGATCGGCGTCGAGGCGAAGGAAGACGGGATGCTGCTCGCGAACCGGTTCGAGAAGGCGGGCACCG
TGATGAACGTCGGCAACCAGGTGTCGCAGGCGGCGGGCGGCATCGTCGTCGGCGTCGAGCGCGCGAAGGCGATGGGCCTG
CTCGCCGACGTCAAGGAAGCGATGTACGACATCAAGCTGCTCGGCGATCTGCTCAAGCAGGCGGTCGATGCGTTCGCCGA
GCACAACCGCGTGCTCGCGCAGCTGATGCAGCAGATGTCGGACGCGGGCGAGATGCAGACGTCGACGGGCAAGCTGATCC
TGCGTAACGCCCGCGCAGTGTAA

Upstream 100 bases:

>100_bases
GCAGAAGGCGCAGTCCTATCTCGACGGGCTCGACGAAGTGGGCGCCGACGCGGCGCCCGCATCCGCCGGGAACGACCACT
AGCCAACAGGAGCTGATCGT

Downstream 100 bases:

>100_bases
TACGGGCGATCACGTTTGTTTACGAAGTCCAAGAGGTGCGTATGTCAATCGGTGTGCAAAGCAGCGGCATCAACATCAGC
CACGCGGAGCTGTCCCGGCT

Product: cell invasion protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 620; Mature: 619

Protein sequence:

>620_residues
MSSGVQGGPAANANAYQTHPLRDAASALGTLSPQAYVDVVSAAQRNFLERMSQLASEQCDAQPAAHDARLDDRPALRAPQ
ERDAPPLGASDTGSRASGAAKLTELLGVLMSVISASSLDELKQRSDIWNQMSKAAQDNLSRLSDAFQRATDEAKAAADAA
EQAAAAAKQAGADAKAADAAVDAAQKRYDDAVKQGLPDDRLQSLKAALEQARQQAGDAHGRADALQADATKKLDAASALA
TQARACEQQVDDAVNQATQQYGASASLRTPQSPRLSGAAELTAVLGKLQELISSGNVKELESKQKLFTEMQAKREAELQK
KSDEYQAQVKKAEEMQKTMGCIGKIVGWVITAVSFAAAAFTGGASLALAAVGLALAVGDEISRATTGVSFMDKLMQPVMD
AILKPLMEMISSLITKALVACGVDQQKAELAGAILGAVVTGVALVAAAFVGASAVKAVASKVIDAMAGQLTKLMDSAIGK
MLVQLIEKFSEKSGLQALGSRTATAMTRMRRAIGVEAKEDGMLLANRFEKAGTVMNVGNQVSQAAGGIVVGVERAKAMGL
LADVKEAMYDIKLLGDLLKQAVDAFAEHNRVLAQLMQQMSDAGEMQTSTGKLILRNARAV

Sequences:

>Translated_620_residues
MSSGVQGGPAANANAYQTHPLRDAASALGTLSPQAYVDVVSAAQRNFLERMSQLASEQCDAQPAAHDARLDDRPALRAPQ
ERDAPPLGASDTGSRASGAAKLTELLGVLMSVISASSLDELKQRSDIWNQMSKAAQDNLSRLSDAFQRATDEAKAAADAA
EQAAAAAKQAGADAKAADAAVDAAQKRYDDAVKQGLPDDRLQSLKAALEQARQQAGDAHGRADALQADATKKLDAASALA
TQARACEQQVDDAVNQATQQYGASASLRTPQSPRLSGAAELTAVLGKLQELISSGNVKELESKQKLFTEMQAKREAELQK
KSDEYQAQVKKAEEMQKTMGCIGKIVGWVITAVSFAAAAFTGGASLALAAVGLALAVGDEISRATTGVSFMDKLMQPVMD
AILKPLMEMISSLITKALVACGVDQQKAELAGAILGAVVTGVALVAAAFVGASAVKAVASKVIDAMAGQLTKLMDSAIGK
MLVQLIEKFSEKSGLQALGSRTATAMTRMRRAIGVEAKEDGMLLANRFEKAGTVMNVGNQVSQAAGGIVVGVERAKAMGL
LADVKEAMYDIKLLGDLLKQAVDAFAEHNRVLAQLMQQMSDAGEMQTSTGKLILRNARAV
>Mature_619_residues
SSGVQGGPAANANAYQTHPLRDAASALGTLSPQAYVDVVSAAQRNFLERMSQLASEQCDAQPAAHDARLDDRPALRAPQE
RDAPPLGASDTGSRASGAAKLTELLGVLMSVISASSLDELKQRSDIWNQMSKAAQDNLSRLSDAFQRATDEAKAAADAAE
QAAAAAKQAGADAKAADAAVDAAQKRYDDAVKQGLPDDRLQSLKAALEQARQQAGDAHGRADALQADATKKLDAASALAT
QARACEQQVDDAVNQATQQYGASASLRTPQSPRLSGAAELTAVLGKLQELISSGNVKELESKQKLFTEMQAKREAELQKK
SDEYQAQVKKAEEMQKTMGCIGKIVGWVITAVSFAAAAFTGGASLALAAVGLALAVGDEISRATTGVSFMDKLMQPVMDA
ILKPLMEMISSLITKALVACGVDQQKAELAGAILGAVVTGVALVAAAFVGASAVKAVASKVIDAMAGQLTKLMDSAIGKM
LVQLIEKFSEKSGLQALGSRTATAMTRMRRAIGVEAKEDGMLLANRFEKAGTVMNVGNQVSQAAGGIVVGVERAKAMGLL
ADVKEAMYDIKLLGDLLKQAVDAFAEHNRVLAQLMQQMSDAGEMQTSTGKLILRNARAV

Specific function: Plays a role in the bacterium-induced formation of multinucleated giant cell (MNGC), which is formed after host cell fusion, as well as in the intercellular spreading of bacteria and in the induction of apoptosis in macrophages. May act in concert with ot

COG id: NA

COG function: NA

Gene ontology:

Cell location: Secreted. Host membrane (By similarity). Note=Secreted via the bsa type III secretion system, and probably inserted into host membranes (By similarity) [H]

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Belongs to the invasin protein B family [H]

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR006972
- InterPro:   IPR003895 [H]

Pfam domain/function: PF04888 SseC [H]

EC number: NA

Molecular weight: Translated: 64680; Mature: 64549

Theoretical pI: Translated: 6.23; Mature: 6.23

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.6 %Cys     (Translated Protein)
3.9 %Met     (Translated Protein)
4.5 %Cys+Met (Translated Protein)
0.6 %Cys     (Mature Protein)
3.7 %Met     (Mature Protein)
4.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSSGVQGGPAANANAYQTHPLRDAASALGTLSPQAYVDVVSAAQRNFLERMSQLASEQCD
CCCCCCCCCCCCCCCCCCCCHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHCC
AQPAAHDARLDDRPALRAPQERDAPPLGASDTGSRASGAAKLTELLGVLMSVISASSLDE
CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHH
LKQRSDIWNQMSKAAQDNLSRLSDAFQRATDEAKAAADAAEQAAAAAKQAGADAKAADAA
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHH
VDAAQKRYDDAVKQGLPDDRLQSLKAALEQARQQAGDAHGRADALQADATKKLDAASALA
HHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHH
TQARACEQQVDDAVNQATQQYGASASLRTPQSPRLSGAAELTAVLGKLQELISSGNVKEL
HHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHCCCHHHH
ESKQKLFTEMQAKREAELQKKSDEYQAQVKKAEEMQKTMGCIGKIVGWVITAVSFAAAAF
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
TGGASLALAAVGLALAVGDEISRATTGVSFMDKLMQPVMDAILKPLMEMISSLITKALVA
CCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
CGVDQQKAELAGAILGAVVTGVALVAAAFVGASAVKAVASKVIDAMAGQLTKLMDSAIGK
HCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
MLVQLIEKFSEKSGLQALGSRTATAMTRMRRAIGVEAKEDGMLLANRFEKAGTVMNVGNQ
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHH
VSQAAGGIVVGVERAKAMGLLADVKEAMYDIKLLGDLLKQAVDAFAEHNRVLAQLMQQMS
HHHHHCCEEEEHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
DAGEMQTSTGKLILRNARAV
HHCCCCCCCCHHHHHCCCCC
>Mature Secondary Structure 
SSGVQGGPAANANAYQTHPLRDAASALGTLSPQAYVDVVSAAQRNFLERMSQLASEQCD
CCCCCCCCCCCCCCCCCCCHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHCC
AQPAAHDARLDDRPALRAPQERDAPPLGASDTGSRASGAAKLTELLGVLMSVISASSLDE
CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHH
LKQRSDIWNQMSKAAQDNLSRLSDAFQRATDEAKAAADAAEQAAAAAKQAGADAKAADAA
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHH
VDAAQKRYDDAVKQGLPDDRLQSLKAALEQARQQAGDAHGRADALQADATKKLDAASALA
HHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHH
TQARACEQQVDDAVNQATQQYGASASLRTPQSPRLSGAAELTAVLGKLQELISSGNVKEL
HHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHCCCHHHH
ESKQKLFTEMQAKREAELQKKSDEYQAQVKKAEEMQKTMGCIGKIVGWVITAVSFAAAAF
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
TGGASLALAAVGLALAVGDEISRATTGVSFMDKLMQPVMDAILKPLMEMISSLITKALVA
CCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
CGVDQQKAELAGAILGAVVTGVALVAAAFVGASAVKAVASKVIDAMAGQLTKLMDSAIGK
HCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
MLVQLIEKFSEKSGLQALGSRTATAMTRMRRAIGVEAKEDGMLLANRFEKAGTVMNVGNQ
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHH
VSQAAGGIVVGVERAKAMGLLADVKEAMYDIKLLGDLLKQAVDAFAEHNRVLAQLMQQMS
HHHHHCCEEEEHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
DAGEMQTSTGKLILRNARAV
HHCCCCCCCCHHHHHCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: NA