Definition Burkholderia mallei NCTC 10247 chromosome II, complete genome.
Accession NC_009079
Length 2,352,693

Click here to switch to the map view.

The map label for this gene is shc [H]

Identifier: 126445737

GI number: 126445737

Start: 2333562

End: 2335535

Strand: Reverse

Name: shc [H]

Synonym: BMA10247_A2394

Alternate gene names: 126445737

Gene position: 2335535-2333562 (Counterclockwise)

Preceding gene: 126447864

Following gene: 126446467

Centisome position: 99.27

GC content: 69.45

Gene sequence:

>1974_bases
ATGAACGACATGACCGAAATGCATACGCTCGACGCAACCGCCGCGCCGGCCGGCCTCGACGCCGCCGTCGCGCGCGCGAC
CGACGCGCTGCTCGCCGCGCAGCAAGCGGACGGCCACTGGGTCTACGAGCTCGAAGCCGATTCGACGATCCCGGCCGAAT
ACGTGCTGCTCGTCCACTATCTCGGCGAGGCGCCGAATGTCGAGCTCGAGCAGAAGATCGCGCGCTATCTGCGCCGGATT
CAGCAGCCGGACGGCGGCTGGCCGCTCTTCACCGACGGTGCGCCGAACATTAGCGCGAGCGTGAAGGCGTACTTCGCGCT
GAAGGTGATCGGCGACGACGAGAACGCCGAGCACATGCAGCGCGCGCGCCGCGCGATCCACGCGATGGGCGGCGCGGAGA
TGTCGAACGTGTTCACGCGGATTCAGCTCGCGCTGTACGGCGTCGTGCCGTGGTACGCGGTGCCGATGATGCCGGTCGAG
ATCATGCTGCTGCCGCAGTGGTTCCCGTTCCATCTATCGAAGGTGTCGTACTGGGCGCGCACCGTGATCGTGCCGCTGCT
CGTGCTGAACGCGAAGCGCCCGGTCGCGAAGAATCCGCGCGGCGTGCGCATCGACGAGCTGTTCAAGGGCGCACCCGTCA
GCACCGGCCTGCTGCCGAAGCAGCCGCACCAGAGCGCCGGCTGGTTTGCGTTCTTCCGCGCGGTCGACGGGGTGCTGCGT
CTCGTCGACGGCCTCTTCCCGCGCTATACGCGCGAGCGCGCGATCCGCCAGGCGGTCGCGTTCGTCGACGAGCGCCTGAA
CGGCGAGGACGGGCTCGGCGCGATCTATCCCGCGATGGCCAACGCGGTGATGATGTACGCGGCGCTCGGCTATCCCGAAG
ATCATCCGAACCGCGCGATCGCGCGCCGCTCGATCGAGAAGCTGCTCGTCGTCGGCGAGCAAGAGGCGTATTGCCAGCCG
TGCCTGTCGCCGGTATGGGACACGTCGCTTGCCGCGCATGCGCTGCTCGAGACGGGCGACGCGCGCGCGCGCGAAGCGGC
GGTGCGCGGCCTCGACTGGCTCGTGCCGCGGCAGATCCTCGACGTGCGCGGCGACTGGATCTCGCGCCGTCCGCACGTGC
GCCCCGGCGGCTGGGCGTTCCAGTACGCGAATGCGCACTATCCGGACGTCGACGACACGGCGGTCGTCGCGATGGCGATG
GACCGCGTCGCGAAGCTCGACCGGACCGACGCGTATCGCGAGTCGATCGCGCGCGCGCGCGAGTGGGTTGTCGGCATGCA
GAGCAGCGACGGCGGCTGGGGCGCGTTCGAGCCGGAAAACACGCAGTACTACCTGAACAACATTCCGTTCTCCGATCACG
GCGCGCTGCTCGATCCGCCGACGGCCGACGTGTCGGGCCGCTGCCTGTCGATGCTCGCGCAGTTCGGCGAGACGAGCGCG
TCGAGCGAGCCCGCGCGCCGCGCGCTCGACTACATGCTCAAGGAGCAGGAGCCGGACGGCAGCTGGTACGGCCGCTGGGG
GATGAACTACATCTACGGCACGTGGACCGCGCTGTGCTCGCTGAACGCGGCGGGCCTCGGCCACGACGATCCGCGCGTGA
AGCGCGCCGCGCAATGGCTGCTGTCGATCCAGAACGCCGACGGCGGCTGGGGCGAGGACGGCGACAGCTACAAGCTCGAC
TACCGCGGCTACGAGCGCGCGCCGAGCACGTCGTCGCAGACCGCGTGGGCGCTGCTCGGCCTGATGGCGGCGGGCGAAGT
CGACAATCCCGCCGTCGCGCGCGGCGTCGATTACCTGCTCGGCACGCAGCGCGAGCACGGCCTGTGGGACGAGACGCGCT
TCACCGCGACGGGCTTCCCGCGCGTGTTCTATCTGCGCTACCACGGCTACCGCAAGTTCTTCCCGCTGTGGGCGCTCGCC
CGCTATCGCAACCTGAAGCGCGCGAACGCGATGCGCGTGACGGTCGGGATGTAA

Upstream 100 bases:

>100_bases
CGGGCGCTTGGACGGCCGTAGGCCGGCCCGCGACGAACGGGCGCGCGCTCCGACCCGGCGAGACCGCCGGGCGCGCGCGC
CGGCAATAAGAGAGGGACCG

Downstream 100 bases:

>100_bases
CGGCCGATGGCTGGTTCCGGCCGTCCGGCCGCACCCGTGATCGCCGTCGCCGGCATGGCGTTCGAGGCGCGGATCGCGCG
CGGCGCGGGCGTCGAGGCGG

Product: squalene-hopene cyclase

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 657; Mature: 657

Protein sequence:

>657_residues
MNDMTEMHTLDATAAPAGLDAAVARATDALLAAQQADGHWVYELEADSTIPAEYVLLVHYLGEAPNVELEQKIARYLRRI
QQPDGGWPLFTDGAPNISASVKAYFALKVIGDDENAEHMQRARRAIHAMGGAEMSNVFTRIQLALYGVVPWYAVPMMPVE
IMLLPQWFPFHLSKVSYWARTVIVPLLVLNAKRPVAKNPRGVRIDELFKGAPVSTGLLPKQPHQSAGWFAFFRAVDGVLR
LVDGLFPRYTRERAIRQAVAFVDERLNGEDGLGAIYPAMANAVMMYAALGYPEDHPNRAIARRSIEKLLVVGEQEAYCQP
CLSPVWDTSLAAHALLETGDARAREAAVRGLDWLVPRQILDVRGDWISRRPHVRPGGWAFQYANAHYPDVDDTAVVAMAM
DRVAKLDRTDAYRESIARAREWVVGMQSSDGGWGAFEPENTQYYLNNIPFSDHGALLDPPTADVSGRCLSMLAQFGETSA
SSEPARRALDYMLKEQEPDGSWYGRWGMNYIYGTWTALCSLNAAGLGHDDPRVKRAAQWLLSIQNADGGWGEDGDSYKLD
YRGYERAPSTSSQTAWALLGLMAAGEVDNPAVARGVDYLLGTQREHGLWDETRFTATGFPRVFYLRYHGYRKFFPLWALA
RYRNLKRANAMRVTVGM

Sequences:

>Translated_657_residues
MNDMTEMHTLDATAAPAGLDAAVARATDALLAAQQADGHWVYELEADSTIPAEYVLLVHYLGEAPNVELEQKIARYLRRI
QQPDGGWPLFTDGAPNISASVKAYFALKVIGDDENAEHMQRARRAIHAMGGAEMSNVFTRIQLALYGVVPWYAVPMMPVE
IMLLPQWFPFHLSKVSYWARTVIVPLLVLNAKRPVAKNPRGVRIDELFKGAPVSTGLLPKQPHQSAGWFAFFRAVDGVLR
LVDGLFPRYTRERAIRQAVAFVDERLNGEDGLGAIYPAMANAVMMYAALGYPEDHPNRAIARRSIEKLLVVGEQEAYCQP
CLSPVWDTSLAAHALLETGDARAREAAVRGLDWLVPRQILDVRGDWISRRPHVRPGGWAFQYANAHYPDVDDTAVVAMAM
DRVAKLDRTDAYRESIARAREWVVGMQSSDGGWGAFEPENTQYYLNNIPFSDHGALLDPPTADVSGRCLSMLAQFGETSA
SSEPARRALDYMLKEQEPDGSWYGRWGMNYIYGTWTALCSLNAAGLGHDDPRVKRAAQWLLSIQNADGGWGEDGDSYKLD
YRGYERAPSTSSQTAWALLGLMAAGEVDNPAVARGVDYLLGTQREHGLWDETRFTATGFPRVFYLRYHGYRKFFPLWALA
RYRNLKRANAMRVTVGM
>Mature_657_residues
MNDMTEMHTLDATAAPAGLDAAVARATDALLAAQQADGHWVYELEADSTIPAEYVLLVHYLGEAPNVELEQKIARYLRRI
QQPDGGWPLFTDGAPNISASVKAYFALKVIGDDENAEHMQRARRAIHAMGGAEMSNVFTRIQLALYGVVPWYAVPMMPVE
IMLLPQWFPFHLSKVSYWARTVIVPLLVLNAKRPVAKNPRGVRIDELFKGAPVSTGLLPKQPHQSAGWFAFFRAVDGVLR
LVDGLFPRYTRERAIRQAVAFVDERLNGEDGLGAIYPAMANAVMMYAALGYPEDHPNRAIARRSIEKLLVVGEQEAYCQP
CLSPVWDTSLAAHALLETGDARAREAAVRGLDWLVPRQILDVRGDWISRRPHVRPGGWAFQYANAHYPDVDDTAVVAMAM
DRVAKLDRTDAYRESIARAREWVVGMQSSDGGWGAFEPENTQYYLNNIPFSDHGALLDPPTADVSGRCLSMLAQFGETSA
SSEPARRALDYMLKEQEPDGSWYGRWGMNYIYGTWTALCSLNAAGLGHDDPRVKRAAQWLLSIQNADGGWGEDGDSYKLD
YRGYERAPSTSSQTAWALLGLMAAGEVDNPAVARGVDYLLGTQREHGLWDETRFTATGFPRVFYLRYHGYRKFFPLWALA
RYRNLKRANAMRVTVGM

Specific function: Catalyzes the cyclization of squalene into hopene. Probably part of an operon y4aABCD involved in the synthesis of an isoprenoid compound [H]

COG id: COG1657

COG function: function code I; Squalene cyclase

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Contains 3 PFTB repeats [H]

Homologues:

Organism=Homo sapiens, GI47933395, Length=652, Percent_Identity=25.920245398773, Blast_Score=194, Evalue=2e-49,
Organism=Homo sapiens, GI47933397, Length=652, Percent_Identity=25.920245398773, Blast_Score=194, Evalue=2e-49,
Organism=Homo sapiens, GI224177558, Length=652, Percent_Identity=25.920245398773, Blast_Score=194, Evalue=2e-49,
Organism=Homo sapiens, GI224177556, Length=652, Percent_Identity=25, Blast_Score=172, Evalue=6e-43,
Organism=Saccharomyces cerevisiae, GI6321863, Length=602, Percent_Identity=23.421926910299, Blast_Score=112, Evalue=1e-25,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR006400
- InterPro:   IPR001330
- InterPro:   IPR018333
- InterPro:   IPR002365
- InterPro:   IPR008930 [H]

Pfam domain/function: PF00432 Prenyltrans [H]

EC number: =5.4.99.17 [H]

Molecular weight: Translated: 73278; Mature: 73278

Theoretical pI: Translated: 6.47; Mature: 6.47

Prosite motif: PS01074 TERPENE_SYNTHASES

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.6 %Cys     (Translated Protein)
3.2 %Met     (Translated Protein)
3.8 %Cys+Met (Translated Protein)
0.6 %Cys     (Mature Protein)
3.2 %Met     (Mature Protein)
3.8 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MNDMTEMHTLDATAAPAGLDAAVARATDALLAAQQADGHWVYELEADSTIPAEYVLLVHY
CCCHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHCCCCCEEEEECCCCCCCHHHHHHHHH
LGEAPNVELEQKIARYLRRIQQPDGGWPLFTDGAPNISASVKAYFALKVIGDDENAEHMQ
HCCCCCCCHHHHHHHHHHHHCCCCCCCCEECCCCCCCCCCEEEEEEEEEECCCCCHHHHH
RARRAIHAMGGAEMSNVFTRIQLALYGVVPWYAVPMMPVEIMLLPQWFPFHLSKVSYWAR
HHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEEEECCCCHHHHHHHHHHHH
TVIVPLLVLNAKRPVAKNPRGVRIDELFKGAPVSTGLLPKQPHQSAGWFAFFRAVDGVLR
HHHHHHHHHCCCCCCCCCCCCCCHHHHHCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHH
LVDGLFPRYTRERAIRQAVAFVDERLNGEDGLGAIYPAMANAVMMYAALGYPEDHPNRAI
HHHHHCCHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHCCCCCCCCCHHH
ARRSIEKLLVVGEQEAYCQPCLSPVWDTSLAAHALLETGDARAREAAVRGLDWLVPRQIL
HHHHHHHHHHCCCCHHHHHHHCCHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHH
DVRGDWISRRPHVRPGGWAFQYANAHYPDVDDTAVVAMAMDRVAKLDRTDAYRESIARAR
HHCCCHHCCCCCCCCCCEEEEECCCCCCCCCCHHHHHHHHHHHHHHCCHHHHHHHHHHHH
EWVVGMQSSDGGWGAFEPENTQYYLNNIPFSDHGALLDPPTADVSGRCLSMLAQFGETSA
HHHEEECCCCCCCCCCCCCCCEEEEECCCCCCCCCCCCCCCCCCCHHHHHHHHHHCCCCC
SSEPARRALDYMLKEQEPDGSWYGRWGMNYIYGTWTALCSLNAAGLGHDDPRVKRAAQWL
CCCHHHHHHHHHHHCCCCCCCEEECCCCCHHHHHHHHHHHCCCCCCCCCCHHHHHHHHHH
LSIQNADGGWGEDGDSYKLDYRGYERAPSTSSQTAWALLGLMAAGEVDNPAVARGVDYLL
HHHCCCCCCCCCCCCCEEEECCCCCCCCCCCCHHHHHHHHHHHCCCCCCCHHHHHHHHHH
GTQREHGLWDETRFTATGFPRVFYLRYHGYRKFFPLWALARYRNLKRANAMRVTVGM
CCCCCCCCCCCCCEEECCCCEEEEEEECCCHHHHHHHHHHHHHHHHHCCEEEEEECC
>Mature Secondary Structure
MNDMTEMHTLDATAAPAGLDAAVARATDALLAAQQADGHWVYELEADSTIPAEYVLLVHY
CCCHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHCCCCCEEEEECCCCCCCHHHHHHHHH
LGEAPNVELEQKIARYLRRIQQPDGGWPLFTDGAPNISASVKAYFALKVIGDDENAEHMQ
HCCCCCCCHHHHHHHHHHHHCCCCCCCCEECCCCCCCCCCEEEEEEEEEECCCCCHHHHH
RARRAIHAMGGAEMSNVFTRIQLALYGVVPWYAVPMMPVEIMLLPQWFPFHLSKVSYWAR
HHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEEEECCCCHHHHHHHHHHHH
TVIVPLLVLNAKRPVAKNPRGVRIDELFKGAPVSTGLLPKQPHQSAGWFAFFRAVDGVLR
HHHHHHHHHCCCCCCCCCCCCCCHHHHHCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHH
LVDGLFPRYTRERAIRQAVAFVDERLNGEDGLGAIYPAMANAVMMYAALGYPEDHPNRAI
HHHHHCCHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHCCCCCCCCCHHH
ARRSIEKLLVVGEQEAYCQPCLSPVWDTSLAAHALLETGDARAREAAVRGLDWLVPRQIL
HHHHHHHHHHCCCCHHHHHHHCCHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHH
DVRGDWISRRPHVRPGGWAFQYANAHYPDVDDTAVVAMAMDRVAKLDRTDAYRESIARAR
HHCCCHHCCCCCCCCCCEEEEECCCCCCCCCCHHHHHHHHHHHHHHCCHHHHHHHHHHHH
EWVVGMQSSDGGWGAFEPENTQYYLNNIPFSDHGALLDPPTADVSGRCLSMLAQFGETSA
HHHEEECCCCCCCCCCCCCCCEEEEECCCCCCCCCCCCCCCCCCCHHHHHHHHHHCCCCC
SSEPARRALDYMLKEQEPDGSWYGRWGMNYIYGTWTALCSLNAAGLGHDDPRVKRAAQWL
CCCHHHHHHHHHHHCCCCCCCEEECCCCCHHHHHHHHHHHCCCCCCCCCCHHHHHHHHHH
LSIQNADGGWGEDGDSYKLDYRGYERAPSTSSQTAWALLGLMAAGEVDNPAVARGVDYLL
HHHCCCCCCCCCCCCCEEEECCCCCCCCCCCCHHHHHHHHHHHCCCCCCCHHHHHHHHHH
GTQREHGLWDETRFTATGFPRVFYLRYHGYRKFFPLWALARYRNLKRANAMRVTVGM
CCCCCCCCCCCCCEEECCCCEEEEEEECCCHHHHHHHHHHHHHHHHHCCEEEEEECC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 9163424 [H]