Definition Azoarcus sp. BH72 chromosome, complete genome.
Accession NC_008702
Length 4,376,040

Click here to switch to the map view.

The map label for this gene is 119900162

Identifier: 119900162

GI number: 119900162

Start: 4244733

End: 4246307

Strand: Direct

Name: 119900162

Synonym: azo3873

Alternate gene names: NA

Gene position: 4244733-4246307 (Clockwise)

Preceding gene: 119900161

Following gene: 119900163

Centisome position: 97.0

GC content: 66.6

Gene sequence:

>1575_bases
ATGAGCGCGAAATTCTCGCTGGACGACGACAGCGTGGTGGTGATCGTCGGCTCCGGCGCCGGCGGCGGCACGCTGGCCGA
CGAACTGACCAAACGCGGCGTGAACGTCGTGATCCTCGAAGCCGGCAAGCACTACACCCAAGCCGATTTCGAGAACGACG
AGTGGGCGATGTTCAAGAAGATCTCGTGGTTGGACAAGCGCATCTCGGCCGGCGGCTGGCATCACACCGAGACCTATCCC
AACCTGCCGGCCTGGATCGTCAAGGGCGTGGGCGGCTCGACCATGCACTTCTCGGGGCTGGCGCTGCGCTTCCTGCCGCA
CGACTTCAAGACCCGCAGCACCTATGGCGAGGTCAAGGGCGCCAACGTGATCGACTGGCCGATCAGCTACGAGGAACTGG
CGCCCTATTACGACATTGCCGAACGCAAGATGGGCGTGGCCGGCACCAAGGCCAGCGGCCTGCCGGAGATGCCGCCCAAC
AACCACTACAAGGTGATCGCCGCCGGCGCCAGGAAGGTGGGCTACAAGGACATCAGCCGCCCGGTCGCCTCCAACACCCG
CGTCAATGACGGCCGCCCGGCCTGCCAGCAGATCGGCTTCTGCATGCAGGGCTGCAAGATCGGCGCCAAGTGGTCGACGC
TGTACTCCGAGATTCCGCGCGCCATCGAAACCGGCCGCGCCGAGCTGCGCCCGCAGAGCATGGTGCTGAAGATCGAGCAC
GACAAATCCGGCAAGGTCAGCGGCGTGCTCTACGCCGACAAGGACGGCCGCCAGCACCTGCAGAAGGCGCGCGTGGTGTG
CGTGGCCGGCAACTCGATCGAGTCGCCGCGGCTGCTGCTGAACTCCGCCTCCAGCATGTTCCCCAACGGCCTGGCGAACA
GCTCCGGCCAGGTCGGCAAGAACTACATGAACCACACCACTGCCGCCGCGATCGCGATCCACAAGGGGCCGGTGTACATG
TACCGCGGCTTCGACATCGCCGCGGTGATCTCCGACGAGGCGCAGTTGAACCCGGACCGCGGCTTCCTCGGCGGCTACCA
TCTGGAAGGGCTGGCGCTGCACCTGCCCTTCACCGCCGCCTTCATGAAGCCGGGCGGCTGGGGCCGCGAGGTGACTTCCG
CGCTGGAGCAGTACGACCACATGAGCTGCGTGTGGGTGTGCGGCGAGGACATGCCGCAGGAAGAGAACGGCATCACCCTG
CATCCGACCGAGAAGGATCAGTACGGCCTGCCCATCCCCATCGTCACCAAGACCGACCACACCAACGACGCGGCGATGCG
CCGCCACGGCCTGGCGCAGTGGCGCAAGGTGTCCGAGGCGGTGGGCGCGACCCGCGTGATCGACATGCCGCCCTACCCCG
CCAGCCACAACATGGGCACCAACCGCATGAGCGCCAACGCCCGCGACGGCGTGCTCAACAAGTGGGGCCAGGCGCACGAC
ATCAAGAACCTGTTCGTCTCCGACGGCAGCCAGTTCACCTCCAGCTCGGCCGCCAACCCGACGCTGACCATCGTCGCGCT
GGCGGTGCGCCAGGCGGAATACATCGCCGGCGCCATGCAGCGGCGCGAACTCTGA

Upstream 100 bases:

>100_bases
ACGGCGCCTGAGCGCCACGCCAGCGGGCAGCCGCCGACCGCCCCCGACCTGAAGGGCATCGGCCTGCCGCACCCATAAAA
CGACATAACGGAGACAAAGC

Downstream 100 bases:

>100_bases
CCGATCCACCCTGGCCGGCCACCCCGGCCGCCCCCACCACACGAAAACAACGGAGACAACCATGACGCTACGCCCCCTGC
TCCACCGCTTGCTCGCCGCC

Product: putative glucase dehydrogenase subunit alpha

Products: NA

Alternate protein names: GA 2-DH dehydrogenase subunit; GADH dehydrogenase subunit [H]

Number of amino acids: Translated: 524; Mature: 523

Protein sequence:

>524_residues
MSAKFSLDDDSVVVIVGSGAGGGTLADELTKRGVNVVILEAGKHYTQADFENDEWAMFKKISWLDKRISAGGWHHTETYP
NLPAWIVKGVGGSTMHFSGLALRFLPHDFKTRSTYGEVKGANVIDWPISYEELAPYYDIAERKMGVAGTKASGLPEMPPN
NHYKVIAAGARKVGYKDISRPVASNTRVNDGRPACQQIGFCMQGCKIGAKWSTLYSEIPRAIETGRAELRPQSMVLKIEH
DKSGKVSGVLYADKDGRQHLQKARVVCVAGNSIESPRLLLNSASSMFPNGLANSSGQVGKNYMNHTTAAAIAIHKGPVYM
YRGFDIAAVISDEAQLNPDRGFLGGYHLEGLALHLPFTAAFMKPGGWGREVTSALEQYDHMSCVWVCGEDMPQEENGITL
HPTEKDQYGLPIPIVTKTDHTNDAAMRRHGLAQWRKVSEAVGATRVIDMPPYPASHNMGTNRMSANARDGVLNKWGQAHD
IKNLFVSDGSQFTSSSAANPTLTIVALAVRQAEYIAGAMQRREL

Sequences:

>Translated_524_residues
MSAKFSLDDDSVVVIVGSGAGGGTLADELTKRGVNVVILEAGKHYTQADFENDEWAMFKKISWLDKRISAGGWHHTETYP
NLPAWIVKGVGGSTMHFSGLALRFLPHDFKTRSTYGEVKGANVIDWPISYEELAPYYDIAERKMGVAGTKASGLPEMPPN
NHYKVIAAGARKVGYKDISRPVASNTRVNDGRPACQQIGFCMQGCKIGAKWSTLYSEIPRAIETGRAELRPQSMVLKIEH
DKSGKVSGVLYADKDGRQHLQKARVVCVAGNSIESPRLLLNSASSMFPNGLANSSGQVGKNYMNHTTAAAIAIHKGPVYM
YRGFDIAAVISDEAQLNPDRGFLGGYHLEGLALHLPFTAAFMKPGGWGREVTSALEQYDHMSCVWVCGEDMPQEENGITL
HPTEKDQYGLPIPIVTKTDHTNDAAMRRHGLAQWRKVSEAVGATRVIDMPPYPASHNMGTNRMSANARDGVLNKWGQAHD
IKNLFVSDGSQFTSSSAANPTLTIVALAVRQAEYIAGAMQRREL
>Mature_523_residues
SAKFSLDDDSVVVIVGSGAGGGTLADELTKRGVNVVILEAGKHYTQADFENDEWAMFKKISWLDKRISAGGWHHTETYPN
LPAWIVKGVGGSTMHFSGLALRFLPHDFKTRSTYGEVKGANVIDWPISYEELAPYYDIAERKMGVAGTKASGLPEMPPNN
HYKVIAAGARKVGYKDISRPVASNTRVNDGRPACQQIGFCMQGCKIGAKWSTLYSEIPRAIETGRAELRPQSMVLKIEHD
KSGKVSGVLYADKDGRQHLQKARVVCVAGNSIESPRLLLNSASSMFPNGLANSSGQVGKNYMNHTTAAAIAIHKGPVYMY
RGFDIAAVISDEAQLNPDRGFLGGYHLEGLALHLPFTAAFMKPGGWGREVTSALEQYDHMSCVWVCGEDMPQEENGITLH
PTEKDQYGLPIPIVTKTDHTNDAAMRRHGLAQWRKVSEAVGATRVIDMPPYPASHNMGTNRMSANARDGVLNKWGQAHDI
KNLFVSDGSQFTSSSAANPTLTIVALAVRQAEYIAGAMQRREL

Specific function: Part of the heterotrimer that catalyzes the conversion of D-gluconate to 2-dehydro-D-gluconate. This subunit functions as the dehydrogenase [H]

COG id: COG2303

COG function: function code E; Choline dehydrogenase and related flavoproteins

Gene ontology:

Cell location: Cell membrane; Peripheral membrane protein; Periplasmic side (Potential) [H]

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Belongs to the GMC oxidoreductase family [H]

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR000172
- InterPro:   IPR007867 [H]

Pfam domain/function: PF05199 GMC_oxred_C; PF00732 GMC_oxred_N [H]

EC number: =1.1.99.3 [H]

Molecular weight: Translated: 57149; Mature: 57018

Theoretical pI: Translated: 8.35; Mature: 8.35

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.1 %Cys     (Translated Protein)
3.4 %Met     (Translated Protein)
4.6 %Cys+Met (Translated Protein)
1.1 %Cys     (Mature Protein)
3.3 %Met     (Mature Protein)
4.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSAKFSLDDDSVVVIVGSGAGGGTLADELTKRGVNVVILEAGKHYTQADFENDEWAMFKK
CCCCCCCCCCCEEEEEECCCCCCHHHHHHHHCCCEEEEECCCCCCCCCCCCCCCHHHHHH
ISWLDKRISAGGWHHTETYPNLPAWIVKGVGGSTMHFSGLALRFLPHDFKTRSTYGEVKG
HHHHHHHHCCCCCCCCCCCCCCCHHHEECCCCCEEEECCEEEEECCCCCCCCCCCCCCCC
ANVIDWPISYEELAPYYDIAERKMGVAGTKASGLPEMPPNNHYKVIAAGARKVGYKDISR
CEEEECCCCHHHHCCHHHHHHHHCCCCCCCCCCCCCCCCCCCEEEEECCCCCCCHHHHCC
PVASNTRVNDGRPACQQIGFCMQGCKIGAKWSTLYSEIPRAIETGRAELRPQSMVLKIEH
CCCCCCCCCCCCHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHCCCCCCCCCEEEEEEEC
DKSGKVSGVLYADKDGRQHLQKARVVCVAGNSIESPRLLLNSASSMFPNGLANSSGQVGK
CCCCCEEEEEEECCCCHHHHHHCEEEEEECCCCCCCHHHHHCHHHHCCCCCCCCCCCHHH
NYMNHTTAAAIAIHKGPVYMYRGFDIAAVISDEAQLNPDRGFLGGYHLEGLALHLPFTAA
HHHHCCCEEEEEEECCCEEEEECCEEEEEECCCCCCCCCCCCCCCEEECCEEEECCEEEE
FMKPGGWGREVTSALEQYDHMSCVWVCGEDMPQEENGITLHPTEKDQYGLPIPIVTKTDH
EECCCCCCHHHHHHHHHHCCCEEEEEECCCCCCCCCCEEECCCCCCCCCCCEEEEECCCC
TNDAAMRRHGLAQWRKVSEAVGATRVIDMPPYPASHNMGTNRMSANARDGVLNKWGQAHD
CCHHHHHHHHHHHHHHHHHHHCCEEEEECCCCCCCCCCCCCCCCCCCCCCHHHHCCCHHH
IKNLFVSDGSQFTSSSAANPTLTIVALAVRQAEYIAGAMQRREL
HHHHHCCCCCCCCCCCCCCCEEEEEHHHHHHHHHHHHHHHHCCC
>Mature Secondary Structure 
SAKFSLDDDSVVVIVGSGAGGGTLADELTKRGVNVVILEAGKHYTQADFENDEWAMFKK
CCCCCCCCCCEEEEEECCCCCCHHHHHHHHCCCEEEEECCCCCCCCCCCCCCCHHHHHH
ISWLDKRISAGGWHHTETYPNLPAWIVKGVGGSTMHFSGLALRFLPHDFKTRSTYGEVKG
HHHHHHHHCCCCCCCCCCCCCCCHHHEECCCCCEEEECCEEEEECCCCCCCCCCCCCCCC
ANVIDWPISYEELAPYYDIAERKMGVAGTKASGLPEMPPNNHYKVIAAGARKVGYKDISR
CEEEECCCCHHHHCCHHHHHHHHCCCCCCCCCCCCCCCCCCCEEEEECCCCCCCHHHHCC
PVASNTRVNDGRPACQQIGFCMQGCKIGAKWSTLYSEIPRAIETGRAELRPQSMVLKIEH
CCCCCCCCCCCCHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHCCCCCCCCCEEEEEEEC
DKSGKVSGVLYADKDGRQHLQKARVVCVAGNSIESPRLLLNSASSMFPNGLANSSGQVGK
CCCCCEEEEEEECCCCHHHHHHCEEEEEECCCCCCCHHHHHCHHHHCCCCCCCCCCCHHH
NYMNHTTAAAIAIHKGPVYMYRGFDIAAVISDEAQLNPDRGFLGGYHLEGLALHLPFTAA
HHHHCCCEEEEEEECCCEEEEECCEEEEEECCCCCCCCCCCCCCCEEECCEEEECCEEEE
FMKPGGWGREVTSALEQYDHMSCVWVCGEDMPQEENGITLHPTEKDQYGLPIPIVTKTDH
EECCCCCCHHHHHHHHHHCCCEEEEEECCCCCCCCCCEEECCCCCCCCCCCEEEEECCCC
TNDAAMRRHGLAQWRKVSEAVGATRVIDMPPYPASHNMGTNRMSANARDGVLNKWGQAHD
CCHHHHHHHHHHHHHHHHHHHCCEEEEECCCCCCCCCCCCCCCCCCCCCCHHHHCCCHHH
IKNLFVSDGSQFTSSSAANPTLTIVALAVRQAEYIAGAMQRREL
HHHHHCCCCCCCCCCCCCCCEEEEEHHHHHHHHHHHHHHHHCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 9352901 [H]