Definition Gluconacetobacter diazotrophicus PAl 5 chromosome, complete genome.
Accession NC_010125
Length 3,944,163

Click here to switch to the map view.

The map label for this gene is glcD [H]

Identifier: 162149094

GI number: 162149094

Start: 3414558

End: 3416027

Strand: Direct

Name: glcD [H]

Synonym: GDI_3324

Alternate gene names: 162149094

Gene position: 3414558-3416027 (Clockwise)

Preceding gene: 162149093

Following gene: 162149095

Centisome position: 86.57

GC content: 72.24

Gene sequence:

>1470_bases
ATGACCGCCTGCCCCGCCCCGACCGCCGACCTGCTGGACCGTCTGGCACATCTGCTGGGTCCCTCGGGCATCCTGACCGC
CCCGTCGGACACCGATCCGTACTGCACGGACTGGCGGGCGCTCTATCACGGCCGCACCGCCGCCGTGCTGCGCCCCGCCG
ACACCGCCGAACTGGCCCAGGCGGTCACGCTGTGCGCCCAGGCGGGGGTGGCGATGGTGCCGCAGGGGGGCAACACAAGC
ATGGTGGGGGGCGCCACCCCGGACGACAGCGGGCGCGAGGTCGTGATCTGCCTGTCGCGCATGAACCGCGTGCGCCGGAT
CGATCCGCTGGACCACACGATGGAAGTCGAGGCCGGGGTGACGCTGAAGGCCGCGCAGGACGCCGCGCGCGAGGCCGGGC
TGATGCTGCCGCTGTCGATTTCATCGGAAGGCTCGGCCCAGATCGGCGGCGTGCTGGCCACCAATGCCGGCGGCAACAAC
ACCGTGCGCTACGGCAACGCGCGGGAACTGGTCCTGGGGCTGGAGGTCGTGCTGCCGGACGGCAGCGTGTTCCACGGGCT
GCGCCGCCTGCGCAAGGACAACACCGGATACGCCCTGCGCCAGCTGTTCGTGGGGTCCGAGGGCACGCTGGGCTTCATCA
CCGCCGCCATCCTGCAGCTTCAGCCGCAGCCGCGCGCGACCGAGGCCGCCCTGTGCGCGGTCGCCGACGCCAAGGGCGCG
CTGGCGCTGTTCGCGGCCTTCCGCGCGCAGGACCCGGCGCTGATCCAGGCGTTCGAATACATGTCCGGCGCCGGCATGGA
CCTGGTCACGCGACTGGTCCCGGGCGCCAGCCTGCCGCTGGCCGAACCGGCACCGGCCTACGTGCTGGTCGAACTGGCCA
CCCCGCGCGCCAATGCCGACCTGCGCGGGGCGCTGGAGGACGTGCTGGGCGCGGCGCTGGAGGACGGCACGGTCACCGAT
GCGGTGATCGCCGAGAGCGAGGGCCAGCGCATGGCCCTGTGGAAGCTGCGCGAGGAACATGCCGAGGCCCAGCGCCGCGC
CGGCGCCAGCGTGAAGAACGACGTCTCGGTCCCGGTCTCGCACGTGCCGGAACTGATCGACCGGGCCACCGCCGCCTGCG
CGGCCCTGATCCCGGGCATCCGCCCGGCGCCGTTCGGCCATATCGGCGACGGGAACATCCATTTCAACCTGGTCCAGCCC
GAAGGCATGGACCCGGCCGCCTTCCTGGCACTGGACCACCGGATCATGGATACGGTGGGGGCCATCGTGCGCGACCTGGA
CGGCTCCTTCTCCGCCGAACACGGGGTGGGGCGGCTGAAGCCCTACATGATGCCGGACTGGCGCGGCGGCGCCGAACTGG
CCACGATGCGCCGGATCAAGGACGCGATCGACCCGCGCGGCCTGCTGAACCCCGGCGCCATATTTCCCCCCGATACGGGG
AATCCGGCCCGCGTGACCCCGGACGCATGA

Upstream 100 bases:

>100_bases
ATGGCCGGCATGGAATTCCTGCACGCCCTGGATACCCCGACCGCGCCCTACAGCGCCACCGCGCTGAAATAGGCCTCATT
ACTTTTCCCGGAATCATTGC

Downstream 100 bases:

>100_bases
CCCCGGACGATCCGGCTGCATAACAGTCGTATAGCACCTATGCCGCGGGGCTTTCGCCGGGCCCCCGGCGGGGCTACACA
TGCGTATGTCGTTCGCCCGA

Product: D-lactate dehydrogenase

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 489; Mature: 488

Protein sequence:

>489_residues
MTACPAPTADLLDRLAHLLGPSGILTAPSDTDPYCTDWRALYHGRTAAVLRPADTAELAQAVTLCAQAGVAMVPQGGNTS
MVGGATPDDSGREVVICLSRMNRVRRIDPLDHTMEVEAGVTLKAAQDAAREAGLMLPLSISSEGSAQIGGVLATNAGGNN
TVRYGNARELVLGLEVVLPDGSVFHGLRRLRKDNTGYALRQLFVGSEGTLGFITAAILQLQPQPRATEAALCAVADAKGA
LALFAAFRAQDPALIQAFEYMSGAGMDLVTRLVPGASLPLAEPAPAYVLVELATPRANADLRGALEDVLGAALEDGTVTD
AVIAESEGQRMALWKLREEHAEAQRRAGASVKNDVSVPVSHVPELIDRATAACAALIPGIRPAPFGHIGDGNIHFNLVQP
EGMDPAAFLALDHRIMDTVGAIVRDLDGSFSAEHGVGRLKPYMMPDWRGGAELATMRRIKDAIDPRGLLNPGAIFPPDTG
NPARVTPDA

Sequences:

>Translated_489_residues
MTACPAPTADLLDRLAHLLGPSGILTAPSDTDPYCTDWRALYHGRTAAVLRPADTAELAQAVTLCAQAGVAMVPQGGNTS
MVGGATPDDSGREVVICLSRMNRVRRIDPLDHTMEVEAGVTLKAAQDAAREAGLMLPLSISSEGSAQIGGVLATNAGGNN
TVRYGNARELVLGLEVVLPDGSVFHGLRRLRKDNTGYALRQLFVGSEGTLGFITAAILQLQPQPRATEAALCAVADAKGA
LALFAAFRAQDPALIQAFEYMSGAGMDLVTRLVPGASLPLAEPAPAYVLVELATPRANADLRGALEDVLGAALEDGTVTD
AVIAESEGQRMALWKLREEHAEAQRRAGASVKNDVSVPVSHVPELIDRATAACAALIPGIRPAPFGHIGDGNIHFNLVQP
EGMDPAAFLALDHRIMDTVGAIVRDLDGSFSAEHGVGRLKPYMMPDWRGGAELATMRRIKDAIDPRGLLNPGAIFPPDTG
NPARVTPDA
>Mature_488_residues
TACPAPTADLLDRLAHLLGPSGILTAPSDTDPYCTDWRALYHGRTAAVLRPADTAELAQAVTLCAQAGVAMVPQGGNTSM
VGGATPDDSGREVVICLSRMNRVRRIDPLDHTMEVEAGVTLKAAQDAAREAGLMLPLSISSEGSAQIGGVLATNAGGNNT
VRYGNARELVLGLEVVLPDGSVFHGLRRLRKDNTGYALRQLFVGSEGTLGFITAAILQLQPQPRATEAALCAVADAKGAL
ALFAAFRAQDPALIQAFEYMSGAGMDLVTRLVPGASLPLAEPAPAYVLVELATPRANADLRGALEDVLGAALEDGTVTDA
VIAESEGQRMALWKLREEHAEAQRRAGASVKNDVSVPVSHVPELIDRATAACAALIPGIRPAPFGHIGDGNIHFNLVQPE
GMDPAAFLALDHRIMDTVGAIVRDLDGSFSAEHGVGRLKPYMMPDWRGGAELATMRRIKDAIDPRGLLNPGAIFPPDTGN
PARVTPDA

Specific function: Unknown

COG id: COG0277

COG function: function code C; FAD/FMN-containing dehydrogenases

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 FAD-binding PCMH-type domain [H]

Homologues:

Organism=Homo sapiens, GI119964728, Length=458, Percent_Identity=37.7729257641921, Blast_Score=265, Evalue=5e-71,
Organism=Homo sapiens, GI37595756, Length=474, Percent_Identity=32.0675105485232, Blast_Score=197, Evalue=2e-50,
Organism=Homo sapiens, GI37595754, Length=497, Percent_Identity=30.5835010060362, Blast_Score=185, Evalue=7e-47,
Organism=Homo sapiens, GI4501993, Length=456, Percent_Identity=23.0263157894737, Blast_Score=88, Evalue=2e-17,
Organism=Escherichia coli, GI1789351, Length=464, Percent_Identity=28.0172413793103, Blast_Score=129, Evalue=5e-31,
Organism=Escherichia coli, GI1787977, Length=530, Percent_Identity=25.4716981132075, Blast_Score=97, Evalue=3e-21,
Organism=Escherichia coli, GI48994907, Length=228, Percent_Identity=27.6315789473684, Blast_Score=74, Evalue=2e-14,
Organism=Caenorhabditis elegans, GI17534361, Length=446, Percent_Identity=33.1838565022422, Blast_Score=240, Evalue=1e-63,
Organism=Caenorhabditis elegans, GI71992373, Length=484, Percent_Identity=28.3057851239669, Blast_Score=160, Evalue=1e-39,
Organism=Caenorhabditis elegans, GI71992381, Length=475, Percent_Identity=27.3684210526316, Blast_Score=154, Evalue=1e-37,
Organism=Caenorhabditis elegans, GI71992392, Length=403, Percent_Identity=29.2803970223325, Blast_Score=140, Evalue=1e-33,
Organism=Caenorhabditis elegans, GI17556096, Length=198, Percent_Identity=23.2323232323232, Blast_Score=69, Evalue=5e-12,
Organism=Saccharomyces cerevisiae, GI6320023, Length=473, Percent_Identity=34.8837209302326, Blast_Score=297, Evalue=2e-81,
Organism=Saccharomyces cerevisiae, GI6320764, Length=460, Percent_Identity=31.9565217391304, Blast_Score=253, Evalue=5e-68,
Organism=Saccharomyces cerevisiae, GI6320027, Length=497, Percent_Identity=28.7726358148893, Blast_Score=187, Evalue=3e-48,
Organism=Drosophila melanogaster, GI18921117, Length=462, Percent_Identity=30.952380952381, Blast_Score=232, Evalue=4e-61,
Organism=Drosophila melanogaster, GI24639277, Length=462, Percent_Identity=30.952380952381, Blast_Score=232, Evalue=4e-61,
Organism=Drosophila melanogaster, GI24639275, Length=462, Percent_Identity=30.952380952381, Blast_Score=232, Evalue=4e-61,
Organism=Drosophila melanogaster, GI24653753, Length=197, Percent_Identity=30.9644670050761, Blast_Score=79, Evalue=1e-14,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR016166
- InterPro:   IPR016167
- InterPro:   IPR016164
- InterPro:   IPR016168
- InterPro:   IPR004113
- InterPro:   IPR004490
- InterPro:   IPR006094
- InterPro:   IPR016171 [H]

Pfam domain/function: PF02913 FAD-oxidase_C; PF01565 FAD_binding_4 [H]

EC number: NA

Molecular weight: Translated: 51274; Mature: 51143

Theoretical pI: Translated: 4.99; Mature: 4.99

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.2 %Cys     (Translated Protein)
2.9 %Met     (Translated Protein)
4.1 %Cys+Met (Translated Protein)
1.2 %Cys     (Mature Protein)
2.7 %Met     (Mature Protein)
3.9 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MTACPAPTADLLDRLAHLLGPSGILTAPSDTDPYCTDWRALYHGRTAAVLRPADTAELAQ
CCCCCCCHHHHHHHHHHHHCCCCEEECCCCCCCCHHHHHHHHCCCEEEEECCCCHHHHHH
AVTLCAQAGVAMVPQGGNTSMVGGATPDDSGREVVICLSRMNRVRRIDPLDHTMEVEAGV
HHHHHHHCCEEEECCCCCCCEECCCCCCCCCCEEEEEHHHHHHHHCCCCCCCCEEECCCE
TLKAAQDAAREAGLMLPLSISSEGSAQIGGVLATNAGGNNTVRYGNARELVLGLEVVLPD
EEHHHHHHHHHCCEEEEEECCCCCCCCCCCEEEECCCCCCCEEECCCEEEEEEEEEEECC
GSVFHGLRRLRKDNTGYALRQLFVGSEGTLGFITAAILQLQPQPRATEAALCAVADAKGA
CHHHHHHHHHHCCCCCHHHHHHHCCCCCCHHHHHHHHHHCCCCCCCHHHHHHHHHCCCCH
LALFAAFRAQDPALIQAFEYMSGAGMDLVTRLVPGASLPLAEPAPAYVLVELATPRANAD
HHHHHHHHCCCHHHHHHHHHHCCCCHHHHHHHCCCCCCCCCCCCCCEEEEEEECCCCCCH
LRGALEDVLGAALEDGTVTDAVIAESEGQRMALWKLREEHAEAQRRAGASVKNDVSVPVS
HHHHHHHHHHHHHCCCCCCHHEEECCCCCEEHHHHHHHHHHHHHHHCCCCCCCCCCCCHH
HVPELIDRATAACAALIPGIRPAPFGHIGDGNIHFNLVQPEGMDPAAFLALDHRIMDTVG
HHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCEEEEEEECCCCCCHHHHHHHHHHHHHHHH
AIVRDLDGSFSAEHGVGRLKPYMMPDWRGGAELATMRRIKDAIDPRGLLNPGAIFPPDTG
HHHHHCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHCCCCCCCCCCCCCCCCCC
NPARVTPDA
CCCCCCCCC
>Mature Secondary Structure 
TACPAPTADLLDRLAHLLGPSGILTAPSDTDPYCTDWRALYHGRTAAVLRPADTAELAQ
CCCCCCHHHHHHHHHHHHCCCCEEECCCCCCCCHHHHHHHHCCCEEEEECCCCHHHHHH
AVTLCAQAGVAMVPQGGNTSMVGGATPDDSGREVVICLSRMNRVRRIDPLDHTMEVEAGV
HHHHHHHCCEEEECCCCCCCEECCCCCCCCCCEEEEEHHHHHHHHCCCCCCCCEEECCCE
TLKAAQDAAREAGLMLPLSISSEGSAQIGGVLATNAGGNNTVRYGNARELVLGLEVVLPD
EEHHHHHHHHHCCEEEEEECCCCCCCCCCCEEEECCCCCCCEEECCCEEEEEEEEEEECC
GSVFHGLRRLRKDNTGYALRQLFVGSEGTLGFITAAILQLQPQPRATEAALCAVADAKGA
CHHHHHHHHHHCCCCCHHHHHHHCCCCCCHHHHHHHHHHCCCCCCCHHHHHHHHHCCCCH
LALFAAFRAQDPALIQAFEYMSGAGMDLVTRLVPGASLPLAEPAPAYVLVELATPRANAD
HHHHHHHHCCCHHHHHHHHHHCCCCHHHHHHHCCCCCCCCCCCCCCEEEEEEECCCCCCH
LRGALEDVLGAALEDGTVTDAVIAESEGQRMALWKLREEHAEAQRRAGASVKNDVSVPVS
HHHHHHHHHHHHHCCCCCCHHEEECCCCCEEHHHHHHHHHHHHHHHCCCCCCCCCCCCHH
HVPELIDRATAACAALIPGIRPAPFGHIGDGNIHFNLVQPEGMDPAAFLALDHRIMDTVG
HHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCEEEEEEECCCCCCHHHHHHHHHHHHHHHH
AIVRDLDGSFSAEHGVGRLKPYMMPDWRGGAELATMRRIKDAIDPRGLLNPGAIFPPDTG
HHHHHCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHCCCCCCCCCCCCCCCCCC
NPARVTPDA
CCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 8969504; 9384377 [H]