The gene/protein map for NC_011353 is currently unavailable.
Definition Escherichia coli O157:H7 str. EC4115, complete genome.
Accession NC_011353
Length 5,572,075

Click here to switch to the map view.

The map label for this gene is betA [H]

Identifier: 209399344

GI number: 209399344

Start: 377103

End: 378791

Strand: Reverse

Name: betA [H]

Synonym: ECH74115_0373

Alternate gene names: 209399344

Gene position: 378791-377103 (Counterclockwise)

Preceding gene: 209401007

Following gene: 209397028

Centisome position: 6.8

GC content: 57.43

Gene sequence:

>1689_bases
TTGCAATTTGACTACATCATTATTGGTGCCGGCTCAGCCGGCAACGTTCTCGCTACCCGTCTGACTGAAGATCCGAATAC
CTCCGTGCTGCTGCTTGAAGCGGGCGGCCCGGACTATCGCTTTGACTTCCGCACCCAGATGCCCGCTGCCCTGGCATTCC
CGCTACAGGGTAAACGCTACAACTGGGCTTACGAGACGGAACCTGAACCGTTTATGAATAACCGTCGCATGGAGTGCGGA
CGCGGTAAAGGCCTGGGTGGATCGTCGCTGATCAACGGCATGTGCTATATCCGTGGCAACGCGATGGATCTCGACAACTG
GGCAAAAGAACCCGGTCTGGAGAACTGGAGTTATCTCGATTGCCTGCCCTACTACCGCAAGGCCGAGACCCGCGACGTGG
GCGAGAACGACTACCACGGCGGCGACGGCCCGGTGAGCGTCACCACCTCCAAACCCGGCGTCAATCCGCTGTTTGAAGCG
ATGATTGAAGCGGGCGTGCAGGCGGGCTACCCGCGCACGGACGATCTCAACGGTTATCAGCAGGAAGGTTTCGGCCCGAT
GGATCGCACCGTCACGCCGCAGGGCCGCCGCGCCAGCACCGCGCGCGGTTATCTCGATCAGGCCAAATCGCGCCCAAACC
TAACCATTCGTACTCACGCCATGACCGATCACATTATTTTTGACTGTAAACGCGCGGTGGGCGTCGAGTGGCTGGAAGGC
GACAGCACCATTCCGACCCGCGCGACGGCGAACAAAGAAGTGCTGTTATGTGCAGGCGCGATTGCCTCACCGCAGATCCT
GCAACGCTCTGGCGTCGGCAACGCTGAACTGTTGGCCGAGTTTGATATTCCGCTGGTGCATGATTTACCCGGCGTCGGTG
AAAATCTTCAGGATCATCTGGAGATGTATCTGCAATATGAGTGCAAAGAACCGGTTTCCCTCTACCCTGCCCTGCAGTGG
TGGAATCAGCCGAAAATCGGTGCGGAGTGGCTGTTTGGCGGCACCGGCGTTGGTGCCAGCAACCACTTTGAAGCAGGCGG
ATTTATTCGCAGCCGAGAGGAATTTGCGTGGCCGAATATTCAGTATCACTTCCTGCCGGTAGCGATTAACTATAACGGCT
CGAATGCAGTGAAAGAGCACGGCTTCCAGTGCCACGTCGGCTCGATGCGCTCGCCAAGCCGTGGGCATGTGCGGATTAAA
TCCCGCGACCCGCACCAGCATCCGGCAATTCTGTTTAACTACATGTCGCACGAACAGGACTGGCAGGAATTCCGCGACGC
AATTCGCATCACCCGCGAGATCATGCATCAACCCGCGCTGGATCAGTATCGTGGCCGCGAAATCAGCCCCGGCACGGAAT
GTCAGACGGATGAGCAGCTCGATGAGTTTGTGCGTAACCACGCCGAAACCGCCTTCCATCCGTGCGGTACCTGCAAAATG
GGCTACGACGAGATGTCCGTGGTTGACGGCGAAGGCCGCGTGCATGGGCTGGAAGGCCTGCGCGTGGTGGATGCGTCAAT
TATGCCGCAGATTATCACCGGGAATTTGAACGCCACGACGATTATGATTGGCGAGAAAATGGCGGATATGATTCGCGGGA
AGGAAGCGTTGCCGAGGAGCACGGCGGGATATTTTGTGGCAAATGGGATGCCAGTAAGAGCGAAAAAAATGAGTCGTGAT
TTGAACTGA

Upstream 100 bases:

>100_bases
CGCGAGAACGGCGTGATGACGCTCCAGAGTTACACCCAGGTGAAGTCCATCCAGGTTGAGATGGCTAAATTCCAGTCCAT
ATTCTAACCAGGAGGTTTAT

Downstream 100 bases:

>100_bases
CTCAGGAACCGATCAGATTGAGAGTTACCGTTCCAGGTATGGGGACAGAATCGTTATATAAAACATAGGGGTAACTCTCA
TGCTTCATAGTGACAACCTC

Product: choline dehydrogenase

Products: NA

Alternate protein names: CDH; CHD [H]

Number of amino acids: Translated: 562; Mature: 562

Protein sequence:

>562_residues
MQFDYIIIGAGSAGNVLATRLTEDPNTSVLLLEAGGPDYRFDFRTQMPAALAFPLQGKRYNWAYETEPEPFMNNRRMECG
RGKGLGGSSLINGMCYIRGNAMDLDNWAKEPGLENWSYLDCLPYYRKAETRDVGENDYHGGDGPVSVTTSKPGVNPLFEA
MIEAGVQAGYPRTDDLNGYQQEGFGPMDRTVTPQGRRASTARGYLDQAKSRPNLTIRTHAMTDHIIFDCKRAVGVEWLEG
DSTIPTRATANKEVLLCAGAIASPQILQRSGVGNAELLAEFDIPLVHDLPGVGENLQDHLEMYLQYECKEPVSLYPALQW
WNQPKIGAEWLFGGTGVGASNHFEAGGFIRSREEFAWPNIQYHFLPVAINYNGSNAVKEHGFQCHVGSMRSPSRGHVRIK
SRDPHQHPAILFNYMSHEQDWQEFRDAIRITREIMHQPALDQYRGREISPGTECQTDEQLDEFVRNHAETAFHPCGTCKM
GYDEMSVVDGEGRVHGLEGLRVVDASIMPQIITGNLNATTIMIGEKMADMIRGKEALPRSTAGYFVANGMPVRAKKMSRD
LN

Sequences:

>Translated_562_residues
MQFDYIIIGAGSAGNVLATRLTEDPNTSVLLLEAGGPDYRFDFRTQMPAALAFPLQGKRYNWAYETEPEPFMNNRRMECG
RGKGLGGSSLINGMCYIRGNAMDLDNWAKEPGLENWSYLDCLPYYRKAETRDVGENDYHGGDGPVSVTTSKPGVNPLFEA
MIEAGVQAGYPRTDDLNGYQQEGFGPMDRTVTPQGRRASTARGYLDQAKSRPNLTIRTHAMTDHIIFDCKRAVGVEWLEG
DSTIPTRATANKEVLLCAGAIASPQILQRSGVGNAELLAEFDIPLVHDLPGVGENLQDHLEMYLQYECKEPVSLYPALQW
WNQPKIGAEWLFGGTGVGASNHFEAGGFIRSREEFAWPNIQYHFLPVAINYNGSNAVKEHGFQCHVGSMRSPSRGHVRIK
SRDPHQHPAILFNYMSHEQDWQEFRDAIRITREIMHQPALDQYRGREISPGTECQTDEQLDEFVRNHAETAFHPCGTCKM
GYDEMSVVDGEGRVHGLEGLRVVDASIMPQIITGNLNATTIMIGEKMADMIRGKEALPRSTAGYFVANGMPVRAKKMSRD
LN
>Mature_562_residues
MQFDYIIIGAGSAGNVLATRLTEDPNTSVLLLEAGGPDYRFDFRTQMPAALAFPLQGKRYNWAYETEPEPFMNNRRMECG
RGKGLGGSSLINGMCYIRGNAMDLDNWAKEPGLENWSYLDCLPYYRKAETRDVGENDYHGGDGPVSVTTSKPGVNPLFEA
MIEAGVQAGYPRTDDLNGYQQEGFGPMDRTVTPQGRRASTARGYLDQAKSRPNLTIRTHAMTDHIIFDCKRAVGVEWLEG
DSTIPTRATANKEVLLCAGAIASPQILQRSGVGNAELLAEFDIPLVHDLPGVGENLQDHLEMYLQYECKEPVSLYPALQW
WNQPKIGAEWLFGGTGVGASNHFEAGGFIRSREEFAWPNIQYHFLPVAINYNGSNAVKEHGFQCHVGSMRSPSRGHVRIK
SRDPHQHPAILFNYMSHEQDWQEFRDAIRITREIMHQPALDQYRGREISPGTECQTDEQLDEFVRNHAETAFHPCGTCKM
GYDEMSVVDGEGRVHGLEGLRVVDASIMPQIITGNLNATTIMIGEKMADMIRGKEALPRSTAGYFVANGMPVRAKKMSRD
LN

Specific function: Can catalyze the oxidation of choline to betaine aldehyde and betaine aldehyde to glycine betaine [H]

COG id: COG2303

COG function: function code E; Choline dehydrogenase and related flavoproteins

Gene ontology:

Cell location: Membrane-Bound [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the GMC oxidoreductase family [H]

Homologues:

Organism=Homo sapiens, GI217272839, Length=543, Percent_Identity=47.8821362799263, Blast_Score=501, Evalue=1e-142,
Organism=Escherichia coli, GI1786503, Length=556, Percent_Identity=98.5611510791367, Blast_Score=1151, Evalue=0.0,
Organism=Caenorhabditis elegans, GI17532301, Length=563, Percent_Identity=44.582593250444, Blast_Score=480, Evalue=1e-136,
Organism=Drosophila melanogaster, GI24642048, Length=573, Percent_Identity=35.2530541012216, Blast_Score=308, Evalue=9e-84,
Organism=Drosophila melanogaster, GI24642059, Length=571, Percent_Identity=35.9019264448336, Blast_Score=303, Evalue=1e-82,
Organism=Drosophila melanogaster, GI45549471, Length=572, Percent_Identity=34.6153846153846, Blast_Score=293, Evalue=2e-79,
Organism=Drosophila melanogaster, GI45551458, Length=572, Percent_Identity=34.6153846153846, Blast_Score=293, Evalue=2e-79,
Organism=Drosophila melanogaster, GI24642042, Length=574, Percent_Identity=34.8432055749129, Blast_Score=285, Evalue=5e-77,
Organism=Drosophila melanogaster, GI17137792, Length=561, Percent_Identity=35.1158645276292, Blast_Score=267, Evalue=1e-71,
Organism=Drosophila melanogaster, GI24642055, Length=581, Percent_Identity=34.4234079173838, Blast_Score=267, Evalue=1e-71,
Organism=Drosophila melanogaster, GI24650267, Length=578, Percent_Identity=33.3910034602076, Blast_Score=254, Evalue=2e-67,
Organism=Drosophila melanogaster, GI24642051, Length=574, Percent_Identity=33.6236933797909, Blast_Score=253, Evalue=3e-67,
Organism=Drosophila melanogaster, GI18859995, Length=572, Percent_Identity=34.0909090909091, Blast_Score=248, Evalue=8e-66,
Organism=Drosophila melanogaster, GI24642039, Length=568, Percent_Identity=33.4507042253521, Blast_Score=246, Evalue=4e-65,
Organism=Drosophila melanogaster, GI24642035, Length=575, Percent_Identity=32.3478260869565, Blast_Score=232, Evalue=5e-61,
Organism=Drosophila melanogaster, GI24642037, Length=576, Percent_Identity=32.6388888888889, Blast_Score=226, Evalue=3e-59,
Organism=Drosophila melanogaster, GI18859993, Length=573, Percent_Identity=33.3333333333333, Blast_Score=223, Evalue=2e-58,
Organism=Drosophila melanogaster, GI24645930, Length=585, Percent_Identity=27.8632478632479, Blast_Score=159, Evalue=5e-39,
Organism=Drosophila melanogaster, GI24642057, Length=585, Percent_Identity=29.0598290598291, Blast_Score=127, Evalue=3e-29,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR011533
- InterPro:   IPR012132
- InterPro:   IPR000172
- InterPro:   IPR007867 [H]

Pfam domain/function: PF05199 GMC_oxred_C; PF00732 GMC_oxred_N [H]

EC number: =1.1.99.1 [H]

Molecular weight: Translated: 62633; Mature: 62633

Theoretical pI: Translated: 5.72; Mature: 5.72

Prosite motif: PS00623 GMC_OXRED_1 ; PS00624 GMC_OXRED_2

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.8 %Cys     (Translated Protein)
3.7 %Met     (Translated Protein)
5.5 %Cys+Met (Translated Protein)
1.8 %Cys     (Mature Protein)
3.7 %Met     (Mature Protein)
5.5 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MQFDYIIIGAGSAGNVLATRLTEDPNTSVLLLEAGGPDYRFDFRTQMPAALAFPLQGKRY
CCEEEEEEECCCCCCEEEEEECCCCCCCEEEEECCCCCCEEEECCCCCCEEECCCCCCEE
NWAYETEPEPFMNNRRMECGRGKGLGGSSLINGMCYIRGNAMDLDNWAKEPGLENWSYLD
CCEECCCCCCCCCCCCCCCCCCCCCCHHHHHCCEEEEECCCCCCHHHHCCCCCCCCCHHH
CLPYYRKAETRDVGENDYHGGDGPVSVTTSKPGVNPLFEAMIEAGVQAGYPRTDDLNGYQ
CCHHHHCCCCCCCCCCCCCCCCCCEEEEECCCCCCHHHHHHHHHHHHCCCCCCCCCCCHH
QEGFGPMDRTVTPQGRRASTARGYLDQAKSRPNLTIRTHAMTDHIIFDCKRAVGVEWLEG
HCCCCCCCCCCCCCCCCCCHHHHHHHHHCCCCCEEEEEECCCCHHHHHHHHHHCCEEECC
DSTIPTRATANKEVLLCAGAIASPQILQRSGVGNAELLAEFDIPLVHDLPGVGENLQDHL
CCCCCCCCCCCCEEEEEECCCCCHHHHHHCCCCCCEEEEECCCCHHHCCCCCCCCHHHHH
EMYLQYECKEPVSLYPALQWWNQPKIGAEWLFGGTGVGASNHFEAGGFIRSREEFAWPNI
HHHHHHCCCCCCHHHHHHHHCCCCCCCCEEEECCCCCCCCCCCCCCCCEECCHHHCCCCC
QYHFLPVAINYNGSNAVKEHGFQCHVGSMRSPSRGHVRIKSRDPHQHPAILFNYMSHEQD
EEEEEEEEEEECCCHHHHHCCCEEEECCCCCCCCCEEEEECCCCCCCCHHHHHHHHCHHH
WQEFRDAIRITREIMHQPALDQYRGREISPGTECQTDEQLDEFVRNHAETAFHPCGTCKM
HHHHHHHHHHHHHHHHCCCHHHHCCCCCCCCCCCCCHHHHHHHHHHHHHHHCCCCCCCCC
GYDEMSVVDGEGRVHGLEGLRVVDASIMPQIITGNLNATTIMIGEKMADMIRGKEALPRS
CCCCEEEECCCCCEECCCCEEEECHHHCCEEEECCCCEEEEEECHHHHHHHCCHHHCCCC
TAGYFVANGMPVRAKKMSRDLN
CCCEEEECCCCCHHHHHHCCCC
>Mature Secondary Structure
MQFDYIIIGAGSAGNVLATRLTEDPNTSVLLLEAGGPDYRFDFRTQMPAALAFPLQGKRY
CCEEEEEEECCCCCCEEEEEECCCCCCCEEEEECCCCCCEEEECCCCCCEEECCCCCCEE
NWAYETEPEPFMNNRRMECGRGKGLGGSSLINGMCYIRGNAMDLDNWAKEPGLENWSYLD
CCEECCCCCCCCCCCCCCCCCCCCCCHHHHHCCEEEEECCCCCCHHHHCCCCCCCCCHHH
CLPYYRKAETRDVGENDYHGGDGPVSVTTSKPGVNPLFEAMIEAGVQAGYPRTDDLNGYQ
CCHHHHCCCCCCCCCCCCCCCCCCEEEEECCCCCCHHHHHHHHHHHHCCCCCCCCCCCHH
QEGFGPMDRTVTPQGRRASTARGYLDQAKSRPNLTIRTHAMTDHIIFDCKRAVGVEWLEG
HCCCCCCCCCCCCCCCCCCHHHHHHHHHCCCCCEEEEEECCCCHHHHHHHHHHCCEEECC
DSTIPTRATANKEVLLCAGAIASPQILQRSGVGNAELLAEFDIPLVHDLPGVGENLQDHL
CCCCCCCCCCCCEEEEEECCCCCHHHHHHCCCCCCEEEEECCCCHHHCCCCCCCCHHHHH
EMYLQYECKEPVSLYPALQWWNQPKIGAEWLFGGTGVGASNHFEAGGFIRSREEFAWPNI
HHHHHHCCCCCCHHHHHHHHCCCCCCCCEEEECCCCCCCCCCCCCCCCEECCHHHCCCCC
QYHFLPVAINYNGSNAVKEHGFQCHVGSMRSPSRGHVRIKSRDPHQHPAILFNYMSHEQD
EEEEEEEEEEECCCHHHHHCCCEEEECCCCCCCCCEEEEECCCCCCCCHHHHHHHHCHHH
WQEFRDAIRITREIMHQPALDQYRGREISPGTECQTDEQLDEFVRNHAETAFHPCGTCKM
HHHHHHHHHHHHHHHHCCCHHHHCCCCCCCCCCCCCHHHHHHHHHHHHHHHCCCCCCCCC
GYDEMSVVDGEGRVHGLEGLRVVDASIMPQIITGNLNATTIMIGEKMADMIRGKEALPRS
CCCCEEEECCCCCEECCCCEEEECHHHCCEEEECCCCEEEEEECHHHHHHHCCHHHCCCC
TAGYFVANGMPVRAKKMSRDLN
CCCEEEECCCCCHHHHHHCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: NA