Definition Burkholderia mallei NCTC 10247 chromosome II, complete genome.
Accession NC_009079
Length 2,352,693

Click here to switch to the map view.

The map label for this gene is betA [H]

Identifier: 126446210

GI number: 126446210

Start: 1389993

End: 1391690

Strand: Direct

Name: betA [H]

Synonym: BMA10247_A1428

Alternate gene names: 126446210

Gene position: 1389993-1391690 (Clockwise)

Preceding gene: 126447112

Following gene: 126447598

Centisome position: 59.08

GC content: 67.31

Gene sequence:

>1698_bases
ATGACGACACGCGAATTCGACTACATCATCTGCGGCGCCGGCTCCGCGGGCAACGTGCTCGCGACGCGCCTCACCGAGGA
TCCGGGCGTCACCGTGCTGCTCCTCGAGGCGGGCGGCCCCGACTACCGTTTCGACTTCCGCACGCAGATGCCGGCGGCGC
TCGCCTACCCGCTGCAAGGCCGCCGCTACAACTGGGCGTACGAAACCGATCCCGAGCCGCACATGAACCACCGCCGGATG
GAATGCGGGCGCGGCAAGGGGCTCGGCGGCTCGTCGCTGATCAATGGGATGTGCTACATCCGCGGCAATGCGCTCGATTA
CGACAACTGGGCGACGCACAAGGGGCTCGAGGACTGGGCGTATCTCGATTGCCTGCCGTACTTCAGGAAGGCCGAGACGC
GCGACGTCGGCCCGAACGACTATCACGGCGGTGACGGCCCGGTCTCCGTGACGACGAGCAAGCCCGGCGTGAATCCGCTG
TTCGAGGCGATGGTCGAGGCCGGCGTGCAGGCCGGCTATCCGCGCACCGACGATCTCAACGGCTATCAGCAGGAAGGCTT
CGGCCCGATGGACCGCACGGTCACGCCGCGCGGCCGCCGCGCCTCGACCGCGCGCGGCTATCTCGACCAGGCGCGCGCGC
GGCCGAATCTCGAAATCGTCACGCACGCGCTTGCCGATCGCATCCTGTTCTCCGGCAAGCGCGCAACGGGCGTCACGTTC
CTGCACGGCAGCGCGCGCGTCACCGCGCACGCGCGCCGCGAAGTGCTCGTGTGCAGCGGCGCGATCGCATCGCCGCAACT
GCTGCAGCGCTCGGGCGTCGGCCCCGGCGAATGGCTGCGCGAGCTCGACATTCCGGTCGTGCTCGACCTGCCCGGCGTCG
GCCGCAATCTGCAGGATCACCTGGAGATGTACATCCAGTTCGAATGCAAGGAGCCGGTATCGCTATATCCGGCGCTCAAG
TGGTGGAACCAGCCGAAGATCGGCCTCGAATGGATGCTCAACGGCACCGGGCTCGGCGCGAGCAACCACTTCGAGGCGGG
CGGCTTCATTCGCACCCGCGACGACGATCCGTGGCCGAACATCCAATATCACTTCCTGCCCGTCGCGATCAATTACAACG
GCTCGAACGCGATCGAGATGCACGGCTTCCAGGCGCACGTCGGCTCGATGCGCTCGCCGAGCTGCGGGCGCGTGAAGCTG
AAGTCGCGCGACCCGCACGCGCATCCGAGCATCCTGTTCAATTACATGGCCGAGGCGCTCGACTGGCGCGAGTTCCGCGA
CGCGATCCGCGCGACGCGCGAGATCATGCGGCAGCCCGCGCTCGACCGCTTCCGCGGCCGCGAGCTGAACCCGGGCGCGG
ATCTGAAAAGCGACAACGAGCTCGATACGTTCGTACGCGCGCGCGCAGAAACGGCATTCCATCCGTCATGCTCGTGCAAG
ATGGGCTACGACGACATGGCGGTGGTCGACAACGAAGGCCGCGTGCACGGGATCGACGGATTGCGGGTCGTCGACGCGTC
GATCATGCCGATCATCACGACCGGCAATCTGAACGCACCGACGATCATGATCGCCGAGAAGATCGCCGACCGGATCCGCA
AGCACAAGCCGCTCGAACGCTCGAACGCGCAATACTACGTCGCGAACGGCGCGCCCGCGCGCGGCGGCAAGCCCGCGCGG
GCGCCCGCCGTCGTATAG

Upstream 100 bases:

>100_bases
AACGGCATCACGACGCTCGAGCACTACACTCGAATCAAATCGGTGCAGGTCGAGCTCGGCCGCTATCAACCGGTGTTCTA
AGCATCAGGAGAACGCAACG

Downstream 100 bases:

>100_bases
AACCAACCGGCCGCGGCCGGCGCGATACGTGGCGCCGAGCGCTCGCTCAGGCGAGCCGGAGCCAACGGGGCCGGCATGTG
CGACGCGCATGCCCGGCCTC

Product: choline dehydrogenase

Products: NA

Alternate protein names: CDH; CHD [H]

Number of amino acids: Translated: 565; Mature: 564

Protein sequence:

>565_residues
MTTREFDYIICGAGSAGNVLATRLTEDPGVTVLLLEAGGPDYRFDFRTQMPAALAYPLQGRRYNWAYETDPEPHMNHRRM
ECGRGKGLGGSSLINGMCYIRGNALDYDNWATHKGLEDWAYLDCLPYFRKAETRDVGPNDYHGGDGPVSVTTSKPGVNPL
FEAMVEAGVQAGYPRTDDLNGYQQEGFGPMDRTVTPRGRRASTARGYLDQARARPNLEIVTHALADRILFSGKRATGVTF
LHGSARVTAHARREVLVCSGAIASPQLLQRSGVGPGEWLRELDIPVVLDLPGVGRNLQDHLEMYIQFECKEPVSLYPALK
WWNQPKIGLEWMLNGTGLGASNHFEAGGFIRTRDDDPWPNIQYHFLPVAINYNGSNAIEMHGFQAHVGSMRSPSCGRVKL
KSRDPHAHPSILFNYMAEALDWREFRDAIRATREIMRQPALDRFRGRELNPGADLKSDNELDTFVRARAETAFHPSCSCK
MGYDDMAVVDNEGRVHGIDGLRVVDASIMPIITTGNLNAPTIMIAEKIADRIRKHKPLERSNAQYYVANGAPARGGKPAR
APAVV

Sequences:

>Translated_565_residues
MTTREFDYIICGAGSAGNVLATRLTEDPGVTVLLLEAGGPDYRFDFRTQMPAALAYPLQGRRYNWAYETDPEPHMNHRRM
ECGRGKGLGGSSLINGMCYIRGNALDYDNWATHKGLEDWAYLDCLPYFRKAETRDVGPNDYHGGDGPVSVTTSKPGVNPL
FEAMVEAGVQAGYPRTDDLNGYQQEGFGPMDRTVTPRGRRASTARGYLDQARARPNLEIVTHALADRILFSGKRATGVTF
LHGSARVTAHARREVLVCSGAIASPQLLQRSGVGPGEWLRELDIPVVLDLPGVGRNLQDHLEMYIQFECKEPVSLYPALK
WWNQPKIGLEWMLNGTGLGASNHFEAGGFIRTRDDDPWPNIQYHFLPVAINYNGSNAIEMHGFQAHVGSMRSPSCGRVKL
KSRDPHAHPSILFNYMAEALDWREFRDAIRATREIMRQPALDRFRGRELNPGADLKSDNELDTFVRARAETAFHPSCSCK
MGYDDMAVVDNEGRVHGIDGLRVVDASIMPIITTGNLNAPTIMIAEKIADRIRKHKPLERSNAQYYVANGAPARGGKPAR
APAVV
>Mature_564_residues
TTREFDYIICGAGSAGNVLATRLTEDPGVTVLLLEAGGPDYRFDFRTQMPAALAYPLQGRRYNWAYETDPEPHMNHRRME
CGRGKGLGGSSLINGMCYIRGNALDYDNWATHKGLEDWAYLDCLPYFRKAETRDVGPNDYHGGDGPVSVTTSKPGVNPLF
EAMVEAGVQAGYPRTDDLNGYQQEGFGPMDRTVTPRGRRASTARGYLDQARARPNLEIVTHALADRILFSGKRATGVTFL
HGSARVTAHARREVLVCSGAIASPQLLQRSGVGPGEWLRELDIPVVLDLPGVGRNLQDHLEMYIQFECKEPVSLYPALKW
WNQPKIGLEWMLNGTGLGASNHFEAGGFIRTRDDDPWPNIQYHFLPVAINYNGSNAIEMHGFQAHVGSMRSPSCGRVKLK
SRDPHAHPSILFNYMAEALDWREFRDAIRATREIMRQPALDRFRGRELNPGADLKSDNELDTFVRARAETAFHPSCSCKM
GYDDMAVVDNEGRVHGIDGLRVVDASIMPIITTGNLNAPTIMIAEKIADRIRKHKPLERSNAQYYVANGAPARGGKPARA
PAVV

Specific function: Can catalyze the oxidation of choline to betaine aldehyde and betaine aldehyde to glycine betaine [H]

COG id: COG2303

COG function: function code E; Choline dehydrogenase and related flavoproteins

Gene ontology:

Cell location: Membrane-Bound [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the GMC oxidoreductase family [H]

Homologues:

Organism=Homo sapiens, GI217272839, Length=549, Percent_Identity=48.9981785063752, Blast_Score=507, Evalue=1e-143,
Organism=Escherichia coli, GI1786503, Length=555, Percent_Identity=77.4774774774775, Blast_Score=915, Evalue=0.0,
Organism=Caenorhabditis elegans, GI17532301, Length=551, Percent_Identity=47.5499092558984, Blast_Score=489, Evalue=1e-138,
Organism=Drosophila melanogaster, GI24642048, Length=570, Percent_Identity=37.1929824561403, Blast_Score=313, Evalue=2e-85,
Organism=Drosophila melanogaster, GI45549471, Length=581, Percent_Identity=36.3166953528399, Blast_Score=311, Evalue=1e-84,
Organism=Drosophila melanogaster, GI45551458, Length=581, Percent_Identity=36.3166953528399, Blast_Score=310, Evalue=1e-84,
Organism=Drosophila melanogaster, GI24642059, Length=570, Percent_Identity=36.3157894736842, Blast_Score=292, Evalue=3e-79,
Organism=Drosophila melanogaster, GI24642042, Length=572, Percent_Identity=36.7132867132867, Blast_Score=291, Evalue=9e-79,
Organism=Drosophila melanogaster, GI24642055, Length=581, Percent_Identity=36.144578313253, Blast_Score=277, Evalue=2e-74,
Organism=Drosophila melanogaster, GI18859995, Length=574, Percent_Identity=35.5400696864112, Blast_Score=257, Evalue=2e-68,
Organism=Drosophila melanogaster, GI24642039, Length=572, Percent_Identity=35.8391608391608, Blast_Score=254, Evalue=1e-67,
Organism=Drosophila melanogaster, GI17137792, Length=563, Percent_Identity=34.8134991119005, Blast_Score=254, Evalue=1e-67,
Organism=Drosophila melanogaster, GI24650267, Length=576, Percent_Identity=34.5486111111111, Blast_Score=253, Evalue=2e-67,
Organism=Drosophila melanogaster, GI24642051, Length=576, Percent_Identity=31.7708333333333, Blast_Score=249, Evalue=3e-66,
Organism=Drosophila melanogaster, GI24642035, Length=574, Percent_Identity=33.2752613240418, Blast_Score=245, Evalue=8e-65,
Organism=Drosophila melanogaster, GI24642037, Length=574, Percent_Identity=32.404181184669, Blast_Score=233, Evalue=2e-61,
Organism=Drosophila melanogaster, GI18859993, Length=576, Percent_Identity=34.2013888888889, Blast_Score=226, Evalue=3e-59,
Organism=Drosophila melanogaster, GI24645930, Length=585, Percent_Identity=26.3247863247863, Blast_Score=140, Evalue=3e-33,
Organism=Drosophila melanogaster, GI24642057, Length=591, Percent_Identity=28.595600676819, Blast_Score=136, Evalue=5e-32,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR011533
- InterPro:   IPR012132
- InterPro:   IPR000172
- InterPro:   IPR007867 [H]

Pfam domain/function: PF05199 GMC_oxred_C; PF00732 GMC_oxred_N [H]

EC number: =1.1.99.1 [H]

Molecular weight: Translated: 62637; Mature: 62505

Theoretical pI: Translated: 7.62; Mature: 7.62

Prosite motif: PS00052 RIBOSOMAL_S7 ; PS00623 GMC_OXRED_1 ; PS00624 GMC_OXRED_2

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.6 %Cys     (Translated Protein)
3.0 %Met     (Translated Protein)
4.6 %Cys+Met (Translated Protein)
1.6 %Cys     (Mature Protein)
2.8 %Met     (Mature Protein)
4.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MTTREFDYIICGAGSAGNVLATRLTEDPGVTVLLLEAGGPDYRFDFRTQMPAALAYPLQG
CCCCCCCEEEECCCCCCCEEEEEECCCCCCEEEEEECCCCCEEEEECCCCCHHEECCCCC
RRYNWAYETDPEPHMNHRRMECGRGKGLGGSSLINGMCYIRGNALDYDNWATHKGLEDWA
CEECCCCCCCCCCCCCCCHHHCCCCCCCCHHHHHCCEEEEECCCCCCCCCCCCCCCCHHH
YLDCLPYFRKAETRDVGPNDYHGGDGPVSVTTSKPGVNPLFEAMVEAGVQAGYPRTDDLN
HHHHHHHHHCCCCCCCCCCCCCCCCCCEEEEECCCCCCHHHHHHHHHHHHCCCCCCCCCC
GYQQEGFGPMDRTVTPRGRRASTARGYLDQARARPNLEIVTHALADRILFSGKRATGVTF
CHHHCCCCCCCCCCCCCCCCCCHHHHHHHHHHCCCCHHHHHHHHHHHHHHCCCCCCCEEE
LHGSARVTAHARREVLVCSGAIASPQLLQRSGVGPGEWLRELDIPVVLDLPGVGRNLQDH
EECCCEEEECCCCEEEEECCCCCCHHHHHHCCCCHHHHHHHCCCCEEEECCCCCCCHHHH
LEMYIQFECKEPVSLYPALKWWNQPKIGLEWMLNGTGLGASNHFEAGGFIRTRDDDPWPN
EEEEEEEECCCCCHHHHHHHHCCCCCCCEEEEEECCCCCCCCCCCCCCEEECCCCCCCCC
IQYHFLPVAINYNGSNAIEMHGFQAHVGSMRSPSCGRVKLKSRDPHAHPSILFNYMAEAL
CEEEEEEEEEEECCCCEEEECCHHHHHCCCCCCCCCEEEECCCCCCCCHHHHHHHHHHHH
DWREFRDAIRATREIMRQPALDRFRGRELNPGADLKSDNELDTFVRARAETAFHPSCSCK
HHHHHHHHHHHHHHHHHCCCHHHHCCCCCCCCCCCCCCCHHHHHHHHHHHHCCCCCCCEE
MGYDDMAVVDNEGRVHGIDGLRVVDASIMPIITTGNLNAPTIMIAEKIADRIRKHKPLER
CCCCCEEEEECCCCEECCCCEEEECCCEEEEEEECCCCCCEEHHHHHHHHHHHHCCCCCC
SNAQYYVANGAPARGGKPARAPAVV
CCCEEEEECCCCCCCCCCCCCCCCC
>Mature Secondary Structure 
TTREFDYIICGAGSAGNVLATRLTEDPGVTVLLLEAGGPDYRFDFRTQMPAALAYPLQG
CCCCCCEEEECCCCCCCEEEEEECCCCCCEEEEEECCCCCEEEEECCCCCHHEECCCCC
RRYNWAYETDPEPHMNHRRMECGRGKGLGGSSLINGMCYIRGNALDYDNWATHKGLEDWA
CEECCCCCCCCCCCCCCCHHHCCCCCCCCHHHHHCCEEEEECCCCCCCCCCCCCCCCHHH
YLDCLPYFRKAETRDVGPNDYHGGDGPVSVTTSKPGVNPLFEAMVEAGVQAGYPRTDDLN
HHHHHHHHHCCCCCCCCCCCCCCCCCCEEEEECCCCCCHHHHHHHHHHHHCCCCCCCCCC
GYQQEGFGPMDRTVTPRGRRASTARGYLDQARARPNLEIVTHALADRILFSGKRATGVTF
CHHHCCCCCCCCCCCCCCCCCCHHHHHHHHHHCCCCHHHHHHHHHHHHHHCCCCCCCEEE
LHGSARVTAHARREVLVCSGAIASPQLLQRSGVGPGEWLRELDIPVVLDLPGVGRNLQDH
EECCCEEEECCCCEEEEECCCCCCHHHHHHCCCCHHHHHHHCCCCEEEECCCCCCCHHHH
LEMYIQFECKEPVSLYPALKWWNQPKIGLEWMLNGTGLGASNHFEAGGFIRTRDDDPWPN
EEEEEEEECCCCCHHHHHHHHCCCCCCCEEEEEECCCCCCCCCCCCCCEEECCCCCCCCC
IQYHFLPVAINYNGSNAIEMHGFQAHVGSMRSPSCGRVKLKSRDPHAHPSILFNYMAEAL
CEEEEEEEEEEECCCCEEEECCHHHHHCCCCCCCCCEEEECCCCCCCCHHHHHHHHHHHH
DWREFRDAIRATREIMRQPALDRFRGRELNPGADLKSDNELDTFVRARAETAFHPSCSCK
HHHHHHHHHHHHHHHHHCCCHHHHCCCCCCCCCCCCCCCHHHHHHHHHHHHCCCCCCCEE
MGYDDMAVVDNEGRVHGIDGLRVVDASIMPIITTGNLNAPTIMIAEKIADRIRKHKPLER
CCCCCEEEEECCCCEECCCCEEEECCCEEEEEEECCCCCCEEHHHHHHHHHHHHCCCCCC
SNAQYYVANGAPARGGKPARAPAVV
CCCEEEEECCCCCCCCCCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: NA