Definition Burkholderia sp. 383 chromosome 1, complete genome.
Accession NC_007510
Length 3,694,126

Click here to switch to the map view.

The map label for this gene is mdlC [H]

Identifier: 78067383

GI number: 78067383

Start: 3035475

End: 3037082

Strand: Reverse

Name: mdlC [H]

Synonym: Bcep18194_A5914

Alternate gene names: 78067383

Gene position: 3037082-3035475 (Counterclockwise)

Preceding gene: 78067388

Following gene: 78067382

Centisome position: 82.21

GC content: 70.96

Gene sequence:

>1608_bases
ATGTCCGGCTACCAGCCCCCTTCCGCCGCACCGATCACCGTTCGCGATGCGGTGATCGACCTGCTTCGCCAGTTCGGCAT
CGACCGCGTGTTCGGCAATCCCGGCTCGACCGAGCTGCCGATGTTCCGCGACTTCCCGGACGATTTCCGCTACGTGCTCG
GCTTGCATGAAGCCGTCGTGGTCGGCATGGCCGACGGCCACGCGCAGGCCACCGGCAACGCGGCGGTCGTCAACCTGCAT
TCGGCGGCAGGCGTCGGTAACGCGATGGGCAATCTTTTCACCGCCTTCAAGAACCGCACACCGCTGATCGTCACCGCGGG
CCAGCAGGCGCGCGCGATCCTGCCGTTCGACCCGTTCCTCGGCGCGACGCAGGCCGCCGAGCTGCCGAAGCCGTACGTGA
AATGGAGCATCGAGCCTGCGCGCGCGCAGGATGTGCCGGCCGCGATCGCGCGTGCATACCGCATCGCGATGCAGGAACCG
CGTGGGCCGGTGTTCGTGTCGATCCCGGTCGACGACTGGGATCAGCCGGCCGAACTGCTGCCGCGCCGCGACGTCAGCAG
CGTCGTGCGGCCCGACCCGGACGCGCTCGCGCGGCTCGGCGACACGCTCGACGCCGCGCGGCGTCCGGCGTTCGTGGTCG
GCGCGGCCGTCGATCGCGCCGGTGCGTGGGACGACGTCGTGCGGCTCGCAGAGCGGCACCGTGCGCGCGTGTACGTCGCG
CCGATGTCTGGGCGCTGCAGTTTCCCCGAGGACCATCCGCTGTTCGCCGGCTTCCTGCCCGCGATCCGCGAGAAGATCGT
CGCGCGGCTCGACGGGCACGACCTCGTGTTTGCGTTCGGCGCGCCCGCGTTCACCTATCACATCGAGGGCTTCGGCCCGC
ACGTGCCGCCGGGCGCGACGCTCGTGCAGCTCGTCGACGATCCGGGCATCGCCGCGTGGACGCCGTCGGGCGATGCGGTC
GTCGGCAACCTGCGGCTCGCCGCGCGCGACCTGCTCGCGCGCCCGGCGCCGCCCGAGCGGCCGATGCCCGCGCCGCGGCC
GCCGCGCGCGCGTGTCGAACCGCCGGCCGCCGGCGAACGTATGTCGGTCGCGTTCGCGCTGCAGACGCTCGCCGACGTGC
GCGACGCGCATGACATCGTCGTCGAAGAAGCGCCGAGCGCACGGGCCGTGATGCAGGAACACCTGCCGTTCACGCATAGC
GGCACGTTCTACACGATGGACAGCGGCGGGCTCGGCTACGGGATGCCGGCCGCCGTCGGCGTCGCGCTCGCGCACCCGGG
CCGGCGCGTGATCGGGCTGATCGGCGACGGGTCGAGCCTGTATTCGATCCAGGCCTTGTGGAGCGCCGCGCAACTGAAGT
TGCCGATCACGTTCGTGATCCTGAACAATCGTCGCTACGCGGCGCTGCAGGATTTCGCGCCGGTGTTCGGCTTCGGCCCG
GACGATCCCGTGCAAGGCACCGATCTGCCGAACCTGGATTTCGTCGCGCTCGCGCAAGGGATGGGCTGCCGAGGCGTGCG
CGTGACCGATGCCGCACACCTGCGCGACACGCTGACCGAGGCGCTGCGCGCTGCAACGCCGGTCGTCGTTGAAGTCGAGA
TTGCCTGA

Upstream 100 bases:

>100_bases
CATGTCGGAACGGTATGGCTTTTCGCAAAAAATACAGTATCGGTGAATGGCTTGCGCTTCGATACTGTGGAAACCGCCAA
GCCACCGAGGAGCGCCAAGC

Downstream 100 bases:

>100_bases
ATGATGTGATGCGCAATGCGCGTCCTTCCGGAGATTCCATGCAAACCGTATCGATGCTGATCGGCGGCGAACGCCGTCAC
TCATCCAGCGGCGCGACCTT

Product: benzoylformate decarboxylase

Products: NA

Alternate protein names: BFD; BFDC [H]

Number of amino acids: Translated: 535; Mature: 534

Protein sequence:

>535_residues
MSGYQPPSAAPITVRDAVIDLLRQFGIDRVFGNPGSTELPMFRDFPDDFRYVLGLHEAVVVGMADGHAQATGNAAVVNLH
SAAGVGNAMGNLFTAFKNRTPLIVTAGQQARAILPFDPFLGATQAAELPKPYVKWSIEPARAQDVPAAIARAYRIAMQEP
RGPVFVSIPVDDWDQPAELLPRRDVSSVVRPDPDALARLGDTLDAARRPAFVVGAAVDRAGAWDDVVRLAERHRARVYVA
PMSGRCSFPEDHPLFAGFLPAIREKIVARLDGHDLVFAFGAPAFTYHIEGFGPHVPPGATLVQLVDDPGIAAWTPSGDAV
VGNLRLAARDLLARPAPPERPMPAPRPPRARVEPPAAGERMSVAFALQTLADVRDAHDIVVEEAPSARAVMQEHLPFTHS
GTFYTMDSGGLGYGMPAAVGVALAHPGRRVIGLIGDGSSLYSIQALWSAAQLKLPITFVILNNRRYAALQDFAPVFGFGP
DDPVQGTDLPNLDFVALAQGMGCRGVRVTDAAHLRDTLTEALRAATPVVVEVEIA

Sequences:

>Translated_535_residues
MSGYQPPSAAPITVRDAVIDLLRQFGIDRVFGNPGSTELPMFRDFPDDFRYVLGLHEAVVVGMADGHAQATGNAAVVNLH
SAAGVGNAMGNLFTAFKNRTPLIVTAGQQARAILPFDPFLGATQAAELPKPYVKWSIEPARAQDVPAAIARAYRIAMQEP
RGPVFVSIPVDDWDQPAELLPRRDVSSVVRPDPDALARLGDTLDAARRPAFVVGAAVDRAGAWDDVVRLAERHRARVYVA
PMSGRCSFPEDHPLFAGFLPAIREKIVARLDGHDLVFAFGAPAFTYHIEGFGPHVPPGATLVQLVDDPGIAAWTPSGDAV
VGNLRLAARDLLARPAPPERPMPAPRPPRARVEPPAAGERMSVAFALQTLADVRDAHDIVVEEAPSARAVMQEHLPFTHS
GTFYTMDSGGLGYGMPAAVGVALAHPGRRVIGLIGDGSSLYSIQALWSAAQLKLPITFVILNNRRYAALQDFAPVFGFGP
DDPVQGTDLPNLDFVALAQGMGCRGVRVTDAAHLRDTLTEALRAATPVVVEVEIA
>Mature_534_residues
SGYQPPSAAPITVRDAVIDLLRQFGIDRVFGNPGSTELPMFRDFPDDFRYVLGLHEAVVVGMADGHAQATGNAAVVNLHS
AAGVGNAMGNLFTAFKNRTPLIVTAGQQARAILPFDPFLGATQAAELPKPYVKWSIEPARAQDVPAAIARAYRIAMQEPR
GPVFVSIPVDDWDQPAELLPRRDVSSVVRPDPDALARLGDTLDAARRPAFVVGAAVDRAGAWDDVVRLAERHRARVYVAP
MSGRCSFPEDHPLFAGFLPAIREKIVARLDGHDLVFAFGAPAFTYHIEGFGPHVPPGATLVQLVDDPGIAAWTPSGDAVV
GNLRLAARDLLARPAPPERPMPAPRPPRARVEPPAAGERMSVAFALQTLADVRDAHDIVVEEAPSARAVMQEHLPFTHSG
TFYTMDSGGLGYGMPAAVGVALAHPGRRVIGLIGDGSSLYSIQALWSAAQLKLPITFVILNNRRYAALQDFAPVFGFGPD
DPVQGTDLPNLDFVALAQGMGCRGVRVTDAAHLRDTLTEALRAATPVVVEVEIA

Specific function: Valine and isoleucine biosynthesis; first step. [C]

COG id: COG0028

COG function: function code EH; Thiamine pyrophosphate-requiring enzymes [acetolactate synthase, pyruvate dehydrogenase (cytochrome), glyoxylate carboligase, phosphonopyruvate decarboxylase]

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the TPP enzyme family [H]

Homologues:

Organism=Escherichia coli, GI87081685, Length=543, Percent_Identity=27.9926335174954, Blast_Score=159, Evalue=4e-40,
Organism=Escherichia coli, GI1790104, Length=541, Percent_Identity=24.2144177449168, Blast_Score=107, Evalue=1e-24,
Organism=Escherichia coli, GI1786717, Length=561, Percent_Identity=25.3119429590018, Blast_Score=103, Evalue=2e-23,
Organism=Escherichia coli, GI1787096, Length=564, Percent_Identity=22.8723404255319, Blast_Score=82, Evalue=9e-17,
Organism=Saccharomyces cerevisiae, GI6323755, Length=554, Percent_Identity=26.173285198556, Blast_Score=135, Evalue=1e-32,

Paralogues:

None

Copy number: 340 Molecules/Cell In: Growth-Phase, Minimal-Media (Based on E. coli). [C]

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR012000
- InterPro:   IPR012001
- InterPro:   IPR000399
- InterPro:   IPR011766 [H]

Pfam domain/function: PF02775 TPP_enzyme_C; PF00205 TPP_enzyme_M; PF02776 TPP_enzyme_N [H]

EC number: =4.1.1.7 [H]

Molecular weight: Translated: 57169; Mature: 57038

Theoretical pI: Translated: 6.06; Mature: 6.06

Prosite motif: PS00187 TPP_ENZYMES

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.4 %Cys     (Translated Protein)
2.2 %Met     (Translated Protein)
2.6 %Cys+Met (Translated Protein)
0.4 %Cys     (Mature Protein)
2.1 %Met     (Mature Protein)
2.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSGYQPPSAAPITVRDAVIDLLRQFGIDRVFGNPGSTELPMFRDFPDDFRYVLGLHEAVV
CCCCCCCCCCCEEHHHHHHHHHHHCCCCEECCCCCCCCCCCCCCCCHHHHHHHHHCEEEE
VGMADGHAQATGNAAVVNLHSAAGVGNAMGNLFTAFKNRTPLIVTAGQQARAILPFDPFL
EEECCCCCCCCCCEEEEEEHHHCCCCHHHHHHHHHHCCCCCEEEECCCCCCEECCCCCCC
GATQAAELPKPYVKWSIEPARAQDVPAAIARAYRIAMQEPRGPVFVSIPVDDWDQPAELL
CCCHHHHCCCCHHEEECCHHCCCCHHHHHHHHHHHHHCCCCCCEEEEEECCCCCCHHHHC
PRRDVSSVVRPDPDALARLGDTLDAARRPAFVVGAAVDRAGAWDDVVRLAERHRARVYVA
CCCCHHHHHCCCHHHHHHHHHHHHHHCCCEEEEEECHHCCCCHHHHHHHHHHCCCEEEEE
PMSGRCSFPEDHPLFAGFLPAIREKIVARLDGHDLVFAFGAPAFTYHIEGFGPHVPPGAT
ECCCCCCCCCCCCHHHHHHHHHHHHHHHHCCCCEEEEEECCCEEEEEECCCCCCCCCCCE
LVQLVDDPGIAAWTPSGDAVVGNLRLAARDLLARPAPPERPMPAPRPPRARVEPPAAGER
EEEEECCCCEEEECCCCCEEEEEHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCH
MSVAFALQTLADVRDAHDIVVEEAPSARAVMQEHLPFTHSGTFYTMDSGGLGYGMPAAVG
HHHHHHHHHHHHHHHHHHHEEECCCCHHHHHHHCCCCCCCCEEEEECCCCCCCCCHHHHH
VALAHPGRRVIGLIGDGSSLYSIQALWSAAQLKLPITFVILNNRRYAALQDFAPVFGFGP
HHHCCCCCEEEEEEECCCCHHHHHHHHHHHEEECCEEEEEECCCCEEHHHHCCHHCCCCC
DDPVQGTDLPNLDFVALAQGMGCRGVRVTDAAHLRDTLTEALRAATPVVVEVEIA
CCCCCCCCCCCCCHHHHHCCCCCCCEEECCHHHHHHHHHHHHHHCCCEEEEEEEC
>Mature Secondary Structure 
SGYQPPSAAPITVRDAVIDLLRQFGIDRVFGNPGSTELPMFRDFPDDFRYVLGLHEAVV
CCCCCCCCCCEEHHHHHHHHHHHCCCCEECCCCCCCCCCCCCCCCHHHHHHHHHCEEEE
VGMADGHAQATGNAAVVNLHSAAGVGNAMGNLFTAFKNRTPLIVTAGQQARAILPFDPFL
EEECCCCCCCCCCEEEEEEHHHCCCCHHHHHHHHHHCCCCCEEEECCCCCCEECCCCCCC
GATQAAELPKPYVKWSIEPARAQDVPAAIARAYRIAMQEPRGPVFVSIPVDDWDQPAELL
CCCHHHHCCCCHHEEECCHHCCCCHHHHHHHHHHHHHCCCCCCEEEEEECCCCCCHHHHC
PRRDVSSVVRPDPDALARLGDTLDAARRPAFVVGAAVDRAGAWDDVVRLAERHRARVYVA
CCCCHHHHHCCCHHHHHHHHHHHHHHCCCEEEEEECHHCCCCHHHHHHHHHHCCCEEEEE
PMSGRCSFPEDHPLFAGFLPAIREKIVARLDGHDLVFAFGAPAFTYHIEGFGPHVPPGAT
ECCCCCCCCCCCCHHHHHHHHHHHHHHHHCCCCEEEEEECCCEEEEEECCCCCCCCCCCE
LVQLVDDPGIAAWTPSGDAVVGNLRLAARDLLARPAPPERPMPAPRPPRARVEPPAAGER
EEEEECCCCEEEECCCCCEEEEEHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCH
MSVAFALQTLADVRDAHDIVVEEAPSARAVMQEHLPFTHSGTFYTMDSGGLGYGMPAAVG
HHHHHHHHHHHHHHHHHHHEEECCCCHHHHHHHCCCCCCCCEEEEECCCCCCCCCHHHHH
VALAHPGRRVIGLIGDGSSLYSIQALWSAAQLKLPITFVILNNRRYAALQDFAPVFGFGP
HHHCCCCCEEEEEEECCCCHHHHHHHHHHHEEECCEEEEEECCCCEEHHHHCCHHCCCCC
DDPVQGTDLPNLDFVALAQGMGCRGVRVTDAAHLRDTLTEALRAATPVVVEVEIA
CCCCCCCCCCCCCHHHHHCCCCCCCEEECCHHHHHHHHHHHHHHCCCEEEEEEEC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 2271624; 7663351; 9665697 [H]