Definition Burkholderia pseudomallei K96243 chromosome 2, complete sequence.
Accession NC_006351
Length 3,173,005

Click here to switch to the map view.

The map label for this gene is bsaN

Identifier: 53722567

GI number: 53722567

Start: 2100565

End: 2101206

Strand: Reverse

Name: bsaN

Synonym: BPSS1546

Alternate gene names: 53722567

Gene position: 2101206-2100565 (Counterclockwise)

Preceding gene: 53722577

Following gene: 53722566

Centisome position: 66.22

GC content: 66.98

Gene sequence:

>642_bases
GTGTCGTTCGGCGCGATGTCCCATGCCGTTTCGATCGACAAGAATAAATCGGCGCTGGTTATCGGCATCGGTCAATTCAA
AATCGCGTCGCGTGAAGGCGCATGGCGTTTTCATGACGTGCCGTTATTCGAGGCGGCGAAATTGCTCGCTTTTCTGGAAA
GCTGCGGCGCGCCGGACGGCGCCGGCCGCGAATATCGCGCGGGGGCGCCGGACGGCGCGGTGATCGACGCGCCCGGCGAT
CTGAGCATCTGGAAATTCGACCGCTGGCTGATCGCCCGCGTGATGGGCGCGCCGCACGGCGCCGATCCGCTGTTCGCGTT
CCTGCGCGCGCAGGAGAGCTACGGGCTCGTGCGCTTCTTGCTGCGCGAGCGTGCGAACCCGCAGCCGATCGCCGCGCTTG
CCGCGCGCTACGGCGTGTCGGAGCCGCACTTTCGCCGGCTGTGCCGGCAGGCGCTCGGCCGCGGCCTGAAGCGCGAGCTT
CGGCAATGGCGCGCCGCGCAGGCGGTGCTCGAGGTGGTCGAGAGCCGCGACAGCATGACCGAGGTCGCGATGAGCAACGG
CTTCGCGTCTTCGTCCCACTTCTCGCGGGAAATCAAGGACTTGTTCGGCATTTCGCCGTGCCGGTTCCGTCGCCGGACAT
GA

Upstream 100 bases:

>100_bases
TAAGTTCGATTGCGTGGTGGTTTCACCCGGAAAATCCAGGTCGTTTGCGGGGCCGGCAATCCGGCTGATCAGGCCGGTGA
CGGAAATCGCGAAACTGGAC

Downstream 100 bases:

>100_bases
GGAGCCCCAACCGATGATGTATGCCGACACGGCCAGACGATACGCAGCCGCGCTTGCCGCGTCGCTGCTGATGACGGGCG
CGGCGTTCGCCGCGCCGACC

Product: AraC family transcription regulator

Products: NA

Alternate protein names: Transcriptional regulator invF [H]

Number of amino acids: Translated: 213; Mature: 212

Protein sequence:

>213_residues
MSFGAMSHAVSIDKNKSALVIGIGQFKIASREGAWRFHDVPLFEAAKLLAFLESCGAPDGAGREYRAGAPDGAVIDAPGD
LSIWKFDRWLIARVMGAPHGADPLFAFLRAQESYGLVRFLLRERANPQPIAALAARYGVSEPHFRRLCRQALGRGLKREL
RQWRAAQAVLEVVESRDSMTEVAMSNGFASSSHFSREIKDLFGISPCRFRRRT

Sequences:

>Translated_213_residues
MSFGAMSHAVSIDKNKSALVIGIGQFKIASREGAWRFHDVPLFEAAKLLAFLESCGAPDGAGREYRAGAPDGAVIDAPGD
LSIWKFDRWLIARVMGAPHGADPLFAFLRAQESYGLVRFLLRERANPQPIAALAARYGVSEPHFRRLCRQALGRGLKREL
RQWRAAQAVLEVVESRDSMTEVAMSNGFASSSHFSREIKDLFGISPCRFRRRT
>Mature_212_residues
SFGAMSHAVSIDKNKSALVIGIGQFKIASREGAWRFHDVPLFEAAKLLAFLESCGAPDGAGREYRAGAPDGAVIDAPGDL
SIWKFDRWLIARVMGAPHGADPLFAFLRAQESYGLVRFLLRERANPQPIAALAARYGVSEPHFRRLCRQALGRGLKRELR
QWRAAQAVLEVVESRDSMTEVAMSNGFASSSHFSREIKDLFGISPCRFRRRT

Specific function: Transcriptional regulator required for the expression of several genes encoding type III secretion system SPI1 effector proteins. The interaction with sicA is necessary for the activation of sigDE (sopB pipC), sicAsipBCDA, and sopE [H]

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 HTH araC/xylS-type DNA-binding domain [H]

Homologues:

None

Paralogues:

None

Copy number: 10-20 Molecules/Cell [C]

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR009057
- InterPro:   IPR012287
- InterPro:   IPR018062
- InterPro:   IPR018060 [H]

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 23606; Mature: 23475

Theoretical pI: Translated: 10.56; Mature: 10.56

Prosite motif: PS00041 HTH_ARAC_FAMILY_1 ; PS01124 HTH_ARAC_FAMILY_2

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.4 %Cys     (Translated Protein)
2.3 %Met     (Translated Protein)
3.8 %Cys+Met (Translated Protein)
1.4 %Cys     (Mature Protein)
1.9 %Met     (Mature Protein)
3.3 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSFGAMSHAVSIDKNKSALVIGIGQFKIASREGAWRFHDVPLFEAAKLLAFLESCGAPDG
CCCCCCHHHEEECCCCCEEEEEECCEEEECCCCCEEECCCCHHHHHHHHHHHHHCCCCCC
AGREYRAGAPDGAVIDAPGDLSIWKFDRWLIARVMGAPHGADPLFAFLRAQESYGLVRFL
CCCCCCCCCCCCCEEECCCCCCHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHH
LRERANPQPIAALAARYGVSEPHFRRLCRQALGRGLKRELRQWRAAQAVLEVVESRDSMT
HHHCCCCCHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
EVAMSNGFASSSHFSREIKDLFGISPCRFRRRT
HHHHHCCCCCHHHHHHHHHHHHCCCCHHHCCCC
>Mature Secondary Structure 
SFGAMSHAVSIDKNKSALVIGIGQFKIASREGAWRFHDVPLFEAAKLLAFLESCGAPDG
CCCCCHHHEEECCCCCEEEEEECCEEEECCCCCEEECCCCHHHHHHHHHHHHHCCCCCC
AGREYRAGAPDGAVIDAPGDLSIWKFDRWLIARVMGAPHGADPLFAFLRAQESYGLVRFL
CCCCCCCCCCCCCEEECCCCCCHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHH
LRERANPQPIAALAARYGVSEPHFRRLCRQALGRGLKRELRQWRAAQAVLEVVESRDSMT
HHHCCCCCHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
EVAMSNGFASSSHFSREIKDLFGISPCRFRRRT
HHHHHCCCCCHHHHHHHHHHHHCCCCHHHCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: DNA [C]

Specific reaction: Protein + DNA = Protein-DNA [C]

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: 11677608; 12644504 [H]