Definition Shewanella pealeana ATCC 700345 chromosome, complete genome.
Accession NC_009901
Length 5,174,581

Click here to switch to the map view.

The map label for this gene is betA [H]

Identifier: 157960835

GI number: 157960835

Start: 1223842

End: 1225539

Strand: Reverse

Name: betA [H]

Synonym: Spea_1007

Alternate gene names: 157960835

Gene position: 1225539-1223842 (Counterclockwise)

Preceding gene: 157960836

Following gene: 157960834

Centisome position: 23.68

GC content: 49.71

Gene sequence:

>1698_bases
ATGACCGCAACGAATCCACAATACGACTATATTATCGTTGGTGCAGGTAGCGCTGGCTGCGTGTTAGCTAACCGCCTATC
GGCCGACTCGAATAATCGGGTGTTACTGCTTGAAACGGGTGGCAGCGATAAGAGCATCTTTATTCAGATGCCTACCGCAC
TCTCGATCCCCATGAATACCAAGAAATACGCTTGGCAATTTGAAACAGATGCAGAGCCTTATCTAGATAACCGCCGCATG
CATTGTCCAAGAGGCAAAGTATTAGGTGGCTCTTCATCGATTAACGGCATGGTGTATGTACGTGGCCACGCTCGTGATTT
TGACGAGTGGCAAGAGCACGGTGCAAAGAACTGGGATTACGCCCACTGCTTGCCCTACTTCAAGAAAGCCGAAAGTTGGG
CATTTGGCGAAGATGAGTACCGCTCAGTTGACGGCCCTCTAGGTGTCAACAACGGCAACCAGATGAAAAACCCACTGTAT
AAGGCGTTTGTTGCCGCTGGCGTCGATGCCGGTTACTTAGCGACTAACGACTACAATGGCGCGCAGCAAGAGGGCTTTGG
CCCTATGCATATGACGGTTAAAAATGGCGTACGTTGGTCTACGGCCAACGCCTACCTAAGACCTGCCATGAAGCGTGAAA
ACCTAACCGTTATCACCCATGCTCAGGTACACAAGATCCTATTTTCAACTAAGCAAGGTGAAGCTAACAAAGCCGTAGGC
GTACGCTTTGAGCGTAAAGGTAAGATGTTAGAGGTTAACGCCAATAAAGAGGTGGTGTTATCGGCAGGCTCGATTGGCTC
GCCGCATATCTTGCAACTCTCTGGTATTGGCGCAGCAGATACCTTAGGCAAGGCTGGCATTGAGCAAATACACGAGCTGC
CAGGCGTAGGTGAGAACCTGCAAGATCACCTCGAATTCTACTTCCAGTTTAAGTGCCTCAAGCCTATTTCGTTAAATGGC
AAACTAGACCCGCTGAATAAACTATTCATCGGTACTCGCTGGATCTTAAACAAATCAGGCCTAGGTGCGACCAATCATTT
CGAATCTTGTGGCTTTATTCGCTCAAAAGCAGGGCTAGAGTGGCCAGATCTGCAATACCACTTCTTGCCAGCGGCGATGC
GTTATGACGGTAAGGAAGCCTTTGCTGGCCATGGTTTTCAGGTGCACATTGGCCACAATAAGCCTAAGAGTCGCGGCAGC
GTCAAAGTGGTGTCAGATGATCCTAAGCAGGCACCTAGCATTCTATTTAACTACCTGTCTCATCAAGATGATATCGAAGG
TTTCCGCGCTTGCGTTCGCTTAACACGAGAGATCATCAACCAGCCTGCGCTAGATGAATTTCGCGGTGAAGAGATCCAAC
CGGGGAGCAGCGTAGAAACCGATGAACAGATAGATAGCTTCGTAAGAAGCGCGGTTGAAAGTGCCTACCATCCCTCTTGC
ACCTGCAAGATGGGAGAAGATGCGATGGCAGTAGTGGATTCAGACACCCGAGTACATGGAATACAGGGTCTTAGGGTGGT
GGATTCTTCCATTTTCCCGACCATTCCAAACGGTAATCTTAACTCGCCGACCATCATGTTAGCCGAGCGTGCCGCCGACT
TAATCTTAGGTAATACGCCACTGGCGCCAAGTGCAGCCGAAGTGGTTGTGAGTCAGGATTGGCAACAGCAGCAAAGGCAA
AGACCACCAGCAAGATAA

Upstream 100 bases:

>100_bases
TGGCCGTGAAAACGGTAGCGAGACCCTAAAAGCTTACACCCAAATCAAAGCCGTATACGTTGGTATGCAGCCCCTTGAAA
GTCCATTTTAAGGAGCTGAC

Downstream 100 bases:

>100_bases
TCGCTTTGGCTTAACTAATGCTGCTTAGTTCATGTGCAAGCGCATTCGTGCTGTACATGAGCTAAGCCTAGCCCCTCCAC
AAACGAGATGAAGATGTTCG

Product: choline dehydrogenase

Products: NA

Alternate protein names: CDH; CHD [H]

Number of amino acids: Translated: 565; Mature: 564

Protein sequence:

>565_residues
MTATNPQYDYIIVGAGSAGCVLANRLSADSNNRVLLLETGGSDKSIFIQMPTALSIPMNTKKYAWQFETDAEPYLDNRRM
HCPRGKVLGGSSSINGMVYVRGHARDFDEWQEHGAKNWDYAHCLPYFKKAESWAFGEDEYRSVDGPLGVNNGNQMKNPLY
KAFVAAGVDAGYLATNDYNGAQQEGFGPMHMTVKNGVRWSTANAYLRPAMKRENLTVITHAQVHKILFSTKQGEANKAVG
VRFERKGKMLEVNANKEVVLSAGSIGSPHILQLSGIGAADTLGKAGIEQIHELPGVGENLQDHLEFYFQFKCLKPISLNG
KLDPLNKLFIGTRWILNKSGLGATNHFESCGFIRSKAGLEWPDLQYHFLPAAMRYDGKEAFAGHGFQVHIGHNKPKSRGS
VKVVSDDPKQAPSILFNYLSHQDDIEGFRACVRLTREIINQPALDEFRGEEIQPGSSVETDEQIDSFVRSAVESAYHPSC
TCKMGEDAMAVVDSDTRVHGIQGLRVVDSSIFPTIPNGNLNSPTIMLAERAADLILGNTPLAPSAAEVVVSQDWQQQQRQ
RPPAR

Sequences:

>Translated_565_residues
MTATNPQYDYIIVGAGSAGCVLANRLSADSNNRVLLLETGGSDKSIFIQMPTALSIPMNTKKYAWQFETDAEPYLDNRRM
HCPRGKVLGGSSSINGMVYVRGHARDFDEWQEHGAKNWDYAHCLPYFKKAESWAFGEDEYRSVDGPLGVNNGNQMKNPLY
KAFVAAGVDAGYLATNDYNGAQQEGFGPMHMTVKNGVRWSTANAYLRPAMKRENLTVITHAQVHKILFSTKQGEANKAVG
VRFERKGKMLEVNANKEVVLSAGSIGSPHILQLSGIGAADTLGKAGIEQIHELPGVGENLQDHLEFYFQFKCLKPISLNG
KLDPLNKLFIGTRWILNKSGLGATNHFESCGFIRSKAGLEWPDLQYHFLPAAMRYDGKEAFAGHGFQVHIGHNKPKSRGS
VKVVSDDPKQAPSILFNYLSHQDDIEGFRACVRLTREIINQPALDEFRGEEIQPGSSVETDEQIDSFVRSAVESAYHPSC
TCKMGEDAMAVVDSDTRVHGIQGLRVVDSSIFPTIPNGNLNSPTIMLAERAADLILGNTPLAPSAAEVVVSQDWQQQQRQ
RPPAR
>Mature_564_residues
TATNPQYDYIIVGAGSAGCVLANRLSADSNNRVLLLETGGSDKSIFIQMPTALSIPMNTKKYAWQFETDAEPYLDNRRMH
CPRGKVLGGSSSINGMVYVRGHARDFDEWQEHGAKNWDYAHCLPYFKKAESWAFGEDEYRSVDGPLGVNNGNQMKNPLYK
AFVAAGVDAGYLATNDYNGAQQEGFGPMHMTVKNGVRWSTANAYLRPAMKRENLTVITHAQVHKILFSTKQGEANKAVGV
RFERKGKMLEVNANKEVVLSAGSIGSPHILQLSGIGAADTLGKAGIEQIHELPGVGENLQDHLEFYFQFKCLKPISLNGK
LDPLNKLFIGTRWILNKSGLGATNHFESCGFIRSKAGLEWPDLQYHFLPAAMRYDGKEAFAGHGFQVHIGHNKPKSRGSV
KVVSDDPKQAPSILFNYLSHQDDIEGFRACVRLTREIINQPALDEFRGEEIQPGSSVETDEQIDSFVRSAVESAYHPSCT
CKMGEDAMAVVDSDTRVHGIQGLRVVDSSIFPTIPNGNLNSPTIMLAERAADLILGNTPLAPSAAEVVVSQDWQQQQRQR
PPAR

Specific function: Can catalyze the oxidation of choline to betaine aldehyde and betaine aldehyde to glycine betaine [H]

COG id: COG2303

COG function: function code E; Choline dehydrogenase and related flavoproteins

Gene ontology:

Cell location: Membrane-Bound [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the GMC oxidoreductase family [H]

Homologues:

Organism=Homo sapiens, GI217272839, Length=544, Percent_Identity=51.1029411764706, Blast_Score=550, Evalue=1e-156,
Organism=Escherichia coli, GI1786503, Length=551, Percent_Identity=52.994555353902, Blast_Score=587, Evalue=1e-169,
Organism=Caenorhabditis elegans, GI17532301, Length=556, Percent_Identity=45.1438848920863, Blast_Score=486, Evalue=1e-138,
Organism=Drosophila melanogaster, GI24642048, Length=583, Percent_Identity=37.0497427101201, Blast_Score=336, Evalue=2e-92,
Organism=Drosophila melanogaster, GI45551458, Length=575, Percent_Identity=35.304347826087, Blast_Score=319, Evalue=4e-87,
Organism=Drosophila melanogaster, GI45549471, Length=575, Percent_Identity=35.304347826087, Blast_Score=318, Evalue=6e-87,
Organism=Drosophila melanogaster, GI24642042, Length=570, Percent_Identity=34.7368421052632, Blast_Score=300, Evalue=2e-81,
Organism=Drosophila melanogaster, GI24642055, Length=570, Percent_Identity=35.0877192982456, Blast_Score=293, Evalue=2e-79,
Organism=Drosophila melanogaster, GI24642059, Length=573, Percent_Identity=35.4275741710297, Blast_Score=293, Evalue=3e-79,
Organism=Drosophila melanogaster, GI17137792, Length=557, Percent_Identity=34.8294434470377, Blast_Score=283, Evalue=2e-76,
Organism=Drosophila melanogaster, GI24642039, Length=574, Percent_Identity=35.191637630662, Blast_Score=274, Evalue=1e-73,
Organism=Drosophila melanogaster, GI24650267, Length=582, Percent_Identity=34.192439862543, Blast_Score=271, Evalue=7e-73,
Organism=Drosophila melanogaster, GI18859995, Length=570, Percent_Identity=33.1578947368421, Blast_Score=261, Evalue=9e-70,
Organism=Drosophila melanogaster, GI18859993, Length=570, Percent_Identity=32.4561403508772, Blast_Score=248, Evalue=1e-65,
Organism=Drosophila melanogaster, GI24642035, Length=572, Percent_Identity=31.1188811188811, Blast_Score=247, Evalue=1e-65,
Organism=Drosophila melanogaster, GI24642037, Length=572, Percent_Identity=31.8181818181818, Blast_Score=245, Evalue=5e-65,
Organism=Drosophila melanogaster, GI24642051, Length=571, Percent_Identity=31.523642732049, Blast_Score=238, Evalue=6e-63,
Organism=Drosophila melanogaster, GI24645930, Length=583, Percent_Identity=28.3018867924528, Blast_Score=168, Evalue=9e-42,
Organism=Drosophila melanogaster, GI24642057, Length=599, Percent_Identity=27.212020033389, Blast_Score=137, Evalue=2e-32,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR011533
- InterPro:   IPR012132
- InterPro:   IPR000172
- InterPro:   IPR007867 [H]

Pfam domain/function: PF05199 GMC_oxred_C; PF00732 GMC_oxred_N [H]

EC number: =1.1.99.1 [H]

Molecular weight: Translated: 62241; Mature: 62110

Theoretical pI: Translated: 7.01; Mature: 7.01

Prosite motif: PS00623 GMC_OXRED_1 ; PS00624 GMC_OXRED_2

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.4 %Cys     (Translated Protein)
2.5 %Met     (Translated Protein)
3.9 %Cys+Met (Translated Protein)
1.4 %Cys     (Mature Protein)
2.3 %Met     (Mature Protein)
3.7 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MTATNPQYDYIIVGAGSAGCVLANRLSADSNNRVLLLETGGSDKSIFIQMPTALSIPMNT
CCCCCCCCCEEEEECCCCCEEEEHCCCCCCCCCEEEEEECCCCCEEEEECCCEEECCCCC
KKYAWQFETDAEPYLDNRRMHCPRGKVLGGSSSINGMVYVRGHARDFDEWQEHGAKNWDY
CEEEEEECCCCCCCCCCCCCCCCCCCEECCCCCCCEEEEEECCCCCHHHHHHCCCCCCCH
AHCLPYFKKAESWAFGEDEYRSVDGPLGVNNGNQMKNPLYKAFVAAGVDAGYLATNDYNG
HHHHHHHHHHCCCCCCCHHHHCCCCCCCCCCCCHHHHHHHHHHHHHCCCCCEEEECCCCC
AQQEGFGPMHMTVKNGVRWSTANAYLRPAMKRENLTVITHAQVHKILFSTKQGEANKAVG
CHHCCCCCEEEEECCCCEEECCCHHHHHHHCCCCEEEEEHHHHHHHHHCCCCCCCCCEEE
VRFERKGKMLEVNANKEVVLSAGSIGSPHILQLSGIGAADTLGKAGIEQIHELPGVGENL
EEEECCCCEEEECCCCEEEEECCCCCCCCEEEEECCCCHHHHHHHHHHHHHHCCCCCCCH
QDHLEFYFQFKCLKPISLNGKLDPLNKLFIGTRWILNKSGLGATNHFESCGFIRSKAGLE
HHHHHHHEEEEEECEEECCCCCCCCHHHHCCEEEEEECCCCCCCCCHHHCCCHHHCCCCC
WPDLQYHFLPAAMRYDGKEAFAGHGFQVHIGHNKPKSRGSVKVVSDDPKQAPSILFNYLS
CCCCEEEEECHHHHCCCCHHHCCCCEEEEECCCCCCCCCCEEEECCCCCHHHHHHHHHHC
HQDDIEGFRACVRLTREIINQPALDEFRGEEIQPGSSVETDEQIDSFVRSAVESAYHPSC
CCCHHHHHHHHHHHHHHHHCCCCHHHHCCCCCCCCCCCCCHHHHHHHHHHHHHHHCCCCE
TCKMGEDAMAVVDSDTRVHGIQGLRVVDSSIFPTIPNGNLNSPTIMLAERAADLILGNTP
EEEECCCEEEEECCCCEEECCCCEEEECCCCCCCCCCCCCCCCEEEEEECCCHHEECCCC
LAPSAAEVVVSQDWQQQQRQRPPAR
CCCCHHHHHHHCHHHHHHHCCCCCC
>Mature Secondary Structure 
TATNPQYDYIIVGAGSAGCVLANRLSADSNNRVLLLETGGSDKSIFIQMPTALSIPMNT
CCCCCCCCEEEEECCCCCEEEEHCCCCCCCCCEEEEEECCCCCEEEEECCCEEECCCCC
KKYAWQFETDAEPYLDNRRMHCPRGKVLGGSSSINGMVYVRGHARDFDEWQEHGAKNWDY
CEEEEEECCCCCCCCCCCCCCCCCCCEECCCCCCCEEEEEECCCCCHHHHHHCCCCCCCH
AHCLPYFKKAESWAFGEDEYRSVDGPLGVNNGNQMKNPLYKAFVAAGVDAGYLATNDYNG
HHHHHHHHHHCCCCCCCHHHHCCCCCCCCCCCCHHHHHHHHHHHHHCCCCCEEEECCCCC
AQQEGFGPMHMTVKNGVRWSTANAYLRPAMKRENLTVITHAQVHKILFSTKQGEANKAVG
CHHCCCCCEEEEECCCCEEECCCHHHHHHHCCCCEEEEEHHHHHHHHHCCCCCCCCCEEE
VRFERKGKMLEVNANKEVVLSAGSIGSPHILQLSGIGAADTLGKAGIEQIHELPGVGENL
EEEECCCCEEEECCCCEEEEECCCCCCCCEEEEECCCCHHHHHHHHHHHHHHCCCCCCCH
QDHLEFYFQFKCLKPISLNGKLDPLNKLFIGTRWILNKSGLGATNHFESCGFIRSKAGLE
HHHHHHHEEEEEECEEECCCCCCCCHHHHCCEEEEEECCCCCCCCCHHHCCCHHHCCCCC
WPDLQYHFLPAAMRYDGKEAFAGHGFQVHIGHNKPKSRGSVKVVSDDPKQAPSILFNYLS
CCCCEEEEECHHHHCCCCHHHCCCCEEEEECCCCCCCCCCEEEECCCCCHHHHHHHHHHC
HQDDIEGFRACVRLTREIINQPALDEFRGEEIQPGSSVETDEQIDSFVRSAVESAYHPSC
CCCHHHHHHHHHHHHHHHHCCCCHHHHCCCCCCCCCCCCCHHHHHHHHHHHHHHHCCCCE
TCKMGEDAMAVVDSDTRVHGIQGLRVVDSSIFPTIPNGNLNSPTIMLAERAADLILGNTP
EEEECCCEEEEECCCCEEECCCCEEEECCCCCCCCCCCCCCCCEEEEEECCCHHEECCCC
LAPSAAEVVVSQDWQQQQRQRPPAR
CCCCHHHHHHHCHHHHHHHCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: NA