| Definition | Myxococcus xanthus DK 1622 chromosome, complete genome. |
|---|---|
| Accession | NC_008095 |
| Length | 9,139,763 |
Click here to switch to the map view.
The map label for this gene is 108759558
Identifier: 108759558
GI number: 108759558
Start: 6183994
End: 6185748
Strand: Direct
Name: 108759558
Synonym: MXAN_4942
Alternate gene names: NA
Gene position: 6183994-6185748 (Clockwise)
Preceding gene: 108760560
Following gene: 108759444
Centisome position: 67.66
GC content: 66.55
Gene sequence:
>1755_bases ATGGCATTTCGTCCCGAGCACTTCGACGCAATCATCGTGGGCTCTGGCTTTGGCGGCTCGGTGATGGCGTACCGACTGGC AGAGGCCGGCTTGCGCGTGTGCGTTCTGGAACGAGGAAAGGCCTATCCACCTGGCACGTTCCCGCGCAGTCCCTACGACA TGCGCAACAACTTCTGGGACCCGAGCAAGGGGTTGCACGGCATGTTCAACCTCTGGTCCTTCCGGGGGCTGGGCGGCGTC GTCTCCTCCGGGCTGGGCGGAGGCTCGCTCATCTACGCCAACGTCATGCTGCGCAAGGACGAGAAGACCTTCGTCCATGA GCATCCGCAGACCGGCGGTTATGAGTATTGGCCTGTCACCCGTGACGACCTCGAAGAACACTACGACGCCGTCGAGCGGA TGATGCACGTCCAGCGATTTCCGCTGGCGCACCCTCCCTACGACGCCACGGCAAAGACGCTGGCCATGAAGCTTGCCGCC GAACGCCTGGGCCGTGCAGCCGACTGGCAGCTTCCTCCGCTGGCCATCACCTTCGCCAACGCCGGGGCGGCGCCCGCGCT CGGCGAGCCCATTCGCGAGGCGGCGCCGAACCTCTTCGGCCGCATGCGAACCACCTGCCGGCTGTGTGGCGAGTGCGACA TCGGGTGCAACTACGGCAGCAAGAACACACTCGACTTCACGTACCTGTCCGCTGCGCATCGCGCGGGGGCTGACCTGCGC ACCCGCGCGGAGGTGAAAGAGTTCTGGCCCGCGGATGGAGGGGGCTACGTGGTTCAGTACGTGGACCATGCCGAGGCCCG CGAAGGCGAGCGGCGCGAGGTGGCCTCGGACCAACTCCAGCGGGTGACGCTCACCGCGGACCGGCTCGTACTGGGGGCGG GCACCTTCGGCACCACGTACCTGCTGCTGAAGAACCGGGCGCACTTTCCACGCCTGAGCGCCCGGCTCGGCACACGCTTC TGCGGCAATGGAGACCTGCTGGGCTTCCTGCTGCGCAGCGTGGACAGCAGCTCCGGGACCCGTCTGCCTCGGGTGCTGGA TGGCGGAAGAGGCCCCGTCATCACCAGCGCGCTCCACTTCCGTGGCAAGGAGGAGGGCGGCACCGGGCGCGGCTACTACA TCGAGGACGCGGGCTACCCGGAGTTCATCAACTGGCTCTATGAAGGCTCGCAGCAGGCCCCCCTTCTGAGGCGAGGCATG CGCCTGGCCTGGCGCCTCGTCAAGGGCTGGATCGGCCTGACGCGCGACACGGATGTCAGCGAGGAGATTGCTGAAGCGCT GGGGGATTGCCTGGGCTCAGCCACGTCGCTGCCGCTACTCGCCATGGGCCGGGACATCCCCAACGGGAACATGCGGCTGA CACGAGATGGGAAGCTGGACATCGACTGGCGCATGCATGGTTCGCGCGAGTACTTCGGCCGTGTGCGGAAATCCATGGAG GACATCGCCGACGCGCTGGAGGCGAAGATGGTGCACAACCCCCTCAGTTACTTGAGCCGGGTCATCACCGTGCATCCGCT GGGTGGTTGCCCCATGGGACAGACGCCAGCAGAAGGGGTGGTGAACGCCCATGGCGAGGCGTTCCACTACCCCGGCCTGT ACGTGGCGGACGGCTCGGTGATGCCTGGCCCCACCGGCCCCAACCCGAGCCTCACCATCGCCGCGCTCGCGGACCGGTTC TCAGACCACTTGATTGCGCACTGGCCACGAACCACGGCGCTCCGCAAACACCCCACCACGGAGGAACGCATATGA
Upstream 100 bases:
>100_bases TCGGCAGGTTCTTCCTGGGGACGCTTTGGGACGTCTATGCGCCCTGGGCCCGGCAGGCGGGGGAAGCGCCCTCCGCCTCA TCCATGGAGAGGAGCTTGTA
Downstream 100 bases:
>100_bases CGATACGAGCTGCCGGCGGGGGAACCGCCATCGGCGCCGGGGGACGCCACGAACCACGCAAGCCGCATGGCAAACCGATG GTGCGGTGGTTCCACCCGAG
Product: hypothetical protein
Products: cholest-4-en-3-one; H2O2
Alternate protein names: Glucose-Methanol-Choline Oxidoreductase; FAD Dependent Oxidoreductase; GMC Oxidoreductase; Oxidoreductase; Choline Dehydrogenase-Like Flavoprotein; Choline Dehydrogenase; Cholesterol Oxidase ChoD; Oxidase; Oxidoreductase Glucose-Methanol-Choline Family; FAD-Dependent Pyridine Nucleotide-Disulfide Oxidoreductase; Gmc Oxidoreductase Family Protein; Ferredoxin Domain Gmc Oxidoreductase; Cholesterol Oxidase ChoD; GMC Family Oxidoreductase; Cholesterol-O2 Oxidoreductase; Fad-Dependent Pyridine Nucleotide-Disulfide Oxidoreductase; GMC Oxidoreductase Family Protein; Cholesterol Oxidase Chod; GMC Oxidoreductase Family
Number of amino acids: Translated: 584; Mature: 583
Protein sequence:
>584_residues MAFRPEHFDAIIVGSGFGGSVMAYRLAEAGLRVCVLERGKAYPPGTFPRSPYDMRNNFWDPSKGLHGMFNLWSFRGLGGV VSSGLGGGSLIYANVMLRKDEKTFVHEHPQTGGYEYWPVTRDDLEEHYDAVERMMHVQRFPLAHPPYDATAKTLAMKLAA ERLGRAADWQLPPLAITFANAGAAPALGEPIREAAPNLFGRMRTTCRLCGECDIGCNYGSKNTLDFTYLSAAHRAGADLR TRAEVKEFWPADGGGYVVQYVDHAEAREGERREVASDQLQRVTLTADRLVLGAGTFGTTYLLLKNRAHFPRLSARLGTRF CGNGDLLGFLLRSVDSSSGTRLPRVLDGGRGPVITSALHFRGKEEGGTGRGYYIEDAGYPEFINWLYEGSQQAPLLRRGM RLAWRLVKGWIGLTRDTDVSEEIAEALGDCLGSATSLPLLAMGRDIPNGNMRLTRDGKLDIDWRMHGSREYFGRVRKSME DIADALEAKMVHNPLSYLSRVITVHPLGGCPMGQTPAEGVVNAHGEAFHYPGLYVADGSVMPGPTGPNPSLTIAALADRF SDHLIAHWPRTTALRKHPTTEERI
Sequences:
>Translated_584_residues MAFRPEHFDAIIVGSGFGGSVMAYRLAEAGLRVCVLERGKAYPPGTFPRSPYDMRNNFWDPSKGLHGMFNLWSFRGLGGV VSSGLGGGSLIYANVMLRKDEKTFVHEHPQTGGYEYWPVTRDDLEEHYDAVERMMHVQRFPLAHPPYDATAKTLAMKLAA ERLGRAADWQLPPLAITFANAGAAPALGEPIREAAPNLFGRMRTTCRLCGECDIGCNYGSKNTLDFTYLSAAHRAGADLR TRAEVKEFWPADGGGYVVQYVDHAEAREGERREVASDQLQRVTLTADRLVLGAGTFGTTYLLLKNRAHFPRLSARLGTRF CGNGDLLGFLLRSVDSSSGTRLPRVLDGGRGPVITSALHFRGKEEGGTGRGYYIEDAGYPEFINWLYEGSQQAPLLRRGM RLAWRLVKGWIGLTRDTDVSEEIAEALGDCLGSATSLPLLAMGRDIPNGNMRLTRDGKLDIDWRMHGSREYFGRVRKSME DIADALEAKMVHNPLSYLSRVITVHPLGGCPMGQTPAEGVVNAHGEAFHYPGLYVADGSVMPGPTGPNPSLTIAALADRF SDHLIAHWPRTTALRKHPTTEERI >Mature_583_residues AFRPEHFDAIIVGSGFGGSVMAYRLAEAGLRVCVLERGKAYPPGTFPRSPYDMRNNFWDPSKGLHGMFNLWSFRGLGGVV SSGLGGGSLIYANVMLRKDEKTFVHEHPQTGGYEYWPVTRDDLEEHYDAVERMMHVQRFPLAHPPYDATAKTLAMKLAAE RLGRAADWQLPPLAITFANAGAAPALGEPIREAAPNLFGRMRTTCRLCGECDIGCNYGSKNTLDFTYLSAAHRAGADLRT RAEVKEFWPADGGGYVVQYVDHAEAREGERREVASDQLQRVTLTADRLVLGAGTFGTTYLLLKNRAHFPRLSARLGTRFC GNGDLLGFLLRSVDSSSGTRLPRVLDGGRGPVITSALHFRGKEEGGTGRGYYIEDAGYPEFINWLYEGSQQAPLLRRGMR LAWRLVKGWIGLTRDTDVSEEIAEALGDCLGSATSLPLLAMGRDIPNGNMRLTRDGKLDIDWRMHGSREYFGRVRKSMED IADALEAKMVHNPLSYLSRVITVHPLGGCPMGQTPAEGVVNAHGEAFHYPGLYVADGSVMPGPTGPNPSLTIAALADRFS DHLIAHWPRTTALRKHPTTEERI
Specific function: Unknown
COG id: COG2303
COG function: function code E; Choline dehydrogenase and related flavoproteins
Gene ontology:
Cell location: Cytoplasmic
Metaboloic importance: NA
Operon status: Not Known
Operon components: None
Similarity: NA
Homologues:
None
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
NA
Pfam domain/function: NA
EC number: 1.1.3.6
Molecular weight: Translated: 64250; Mature: 64119
Theoretical pI: Translated: 7.86; Mature: 7.86
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.4 %Cys (Translated Protein) 2.9 %Met (Translated Protein) 4.3 %Cys+Met (Translated Protein) 1.4 %Cys (Mature Protein) 2.7 %Met (Mature Protein) 4.1 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MAFRPEHFDAIIVGSGFGGSVMAYRLAEAGLRVCVLERGKAYPPGTFPRSPYDMRNNFWD CCCCCCCCCEEEEECCCCCHHHHHHHHHCCCEEEEEECCCCCCCCCCCCCCHHHHCCCCC PSKGLHGMFNLWSFRGLGGVVSSGLGGGSLIYANVMLRKDEKTFVHEHPQTGGYEYWPVT CCCCCHHHHHHHHHHCCCHHHHCCCCCCEEEEEEEEEECCCHHHHHCCCCCCCEEECCCC RDDLEEHYDAVERMMHVQRFPLAHPPYDATAKTLAMKLAAERLGRAADWQLPPLAITFAN HHHHHHHHHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHCCCCCCCCCCEEEEECC AGAAPALGEPIREAAPNLFGRMRTTCRLCGECDIGCNYGSKNTLDFTYLSAAHRAGADLR CCCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCEEEHHHHHHHHCCCCHH TRAEVKEFWPADGGGYVVQYVDHAEAREGERREVASDQLQRVTLTADRLVLGAGTFGTTY HHHHHHHHCCCCCCCEEEEEECHHHHCCCHHHHHHHHHHHEEEEEECEEEEECCCCCCEE LLLKNRAHFPRLSARLGTRFCGNGDLLGFLLRSVDSSSGTRLPRVLDGGRGPVITSALHF EEEECCCCCCHHHHHHCCCCCCCCHHHHHHHHHHCCCCCCCCCHHHCCCCCCEEEHHHHH RGKEEGGTGRGYYIEDAGYPEFINWLYEGSQQAPLLRRGMRLAWRLVKGWIGLTRDTDVS CCCCCCCCCCCEEECCCCCHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHCCCCCCCHH EEIAEALGDCLGSATSLPLLAMGRDIPNGNMRLTRDGKLDIDWRMHGSREYFGRVRKSME HHHHHHHHHHHCCCCCCCHHHHCCCCCCCCEEEEECCCEEEEEEECCCHHHHHHHHHHHH DIADALEAKMVHNPLSYLSRVITVHPLGGCPMGQTPAEGVVNAHGEAFHYPGLYVADGSV HHHHHHHHHHHHHHHHHHHHHHEEECCCCCCCCCCCCCCHHCCCCCEEECCCEEEECCCC MPGPTGPNPSLTIAALADRFSDHLIAHWPRTTALRKHPTTEERI CCCCCCCCCCEEHHHHHHHHHCCCEEECCCHHHHCCCCCHHCCC >Mature Secondary Structure AFRPEHFDAIIVGSGFGGSVMAYRLAEAGLRVCVLERGKAYPPGTFPRSPYDMRNNFWD CCCCCCCCEEEEECCCCCHHHHHHHHHCCCEEEEEECCCCCCCCCCCCCCHHHHCCCCC PSKGLHGMFNLWSFRGLGGVVSSGLGGGSLIYANVMLRKDEKTFVHEHPQTGGYEYWPVT CCCCCHHHHHHHHHHCCCHHHHCCCCCCEEEEEEEEEECCCHHHHHCCCCCCCEEECCCC RDDLEEHYDAVERMMHVQRFPLAHPPYDATAKTLAMKLAAERLGRAADWQLPPLAITFAN HHHHHHHHHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHCCCCCCCCCCEEEEECC AGAAPALGEPIREAAPNLFGRMRTTCRLCGECDIGCNYGSKNTLDFTYLSAAHRAGADLR CCCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCEEEHHHHHHHHCCCCHH TRAEVKEFWPADGGGYVVQYVDHAEAREGERREVASDQLQRVTLTADRLVLGAGTFGTTY HHHHHHHHCCCCCCCEEEEEECHHHHCCCHHHHHHHHHHHEEEEEECEEEEECCCCCCEE LLLKNRAHFPRLSARLGTRFCGNGDLLGFLLRSVDSSSGTRLPRVLDGGRGPVITSALHF EEEECCCCCCHHHHHHCCCCCCCCHHHHHHHHHHCCCCCCCCCHHHCCCCCCEEEHHHHH RGKEEGGTGRGYYIEDAGYPEFINWLYEGSQQAPLLRRGMRLAWRLVKGWIGLTRDTDVS CCCCCCCCCCCEEECCCCCHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHCCCCCCCHH EEIAEALGDCLGSATSLPLLAMGRDIPNGNMRLTRDGKLDIDWRMHGSREYFGRVRKSME HHHHHHHHHHHCCCCCCCHHHHCCCCCCCCEEEEECCCEEEEEEECCCHHHHHHHHHHHH DIADALEAKMVHNPLSYLSRVITVHPLGGCPMGQTPAEGVVNAHGEAFHYPGLYVADGSV HHHHHHHHHHHHHHHHHHHHHHEEECCCCCCCCCCCCCCHHCCCCCEEECCCEEEECCCC MPGPTGPNPSLTIAALADRFSDHLIAHWPRTTALRKHPTTEERI CCCCCCCCCCEEHHHHHHHHHCCCEEECCCHHHHCCCCCHHCCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: cholesterol; O2
Specific reaction: cholesterol + O2 = cholest-4-en-3-one + H2O2
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: NA