The gene/protein map for NC_007794 is currently unavailable.
Definition Novosphingobium aromaticivorans DSM 12444 chromosome, complete genome.
Accession NC_007794
Length 3,561,584

Click here to switch to the map view.

The map label for this gene is xylB [H]

Identifier: 87200517

GI number: 87200517

Start: 2706568

End: 2707683

Strand: Reverse

Name: xylB [H]

Synonym: Saro_2504

Alternate gene names: 87200517

Gene position: 2707683-2706568 (Counterclockwise)

Preceding gene: 87200518

Following gene: 87200516

Centisome position: 76.02

GC content: 65.59

Gene sequence:

>1116_bases
ATGACCACCTGCTGTGCCGCTGTCGCCCGTGGGGCGAACCAGCCCTTCACCATCGAGCAACTGACGGTGGACGGACCGCG
TGCGGGCGAGGTGCTGGTACAAATCGCGGGCGTCGGTCTGTGCCATACGGACCTTGTTTTCCGCGACCAGTTCGACGCCT
TTGCCAAGCCCGGCGTGCTTGGTCACGAAGGGGCCGGCGTGATCGAGGCGGTGGGAGAGGGTGTGACCGGCCTTGCCGCA
GGCGACCGGGTTGTCCTCGGCTTTTCGTCGTGCGGCGAATGCGCGCGGTGCGCCGAGGATCTGCCCAGCTACTGCGTGCA
ATTCGTGCCGTTGAACTATGCCGGGATGCGGCTGGACGACGGTTCGACCGCCCATGCGGCACACGATGGCGAGCGGGTGT
CGTCGCATTTCTTCGGCCAGTCTTCCTTCGCCACGCTTGCGGTGACGCGGGCCCGCAACGTGGTGAAAGTGCCGGATTCC
ACGACGGTTCCGCTCGAACTGCTCGGACCGCTCGGGTGCGGCTTGATGACCGGTGCCGGGGCGGTGATGAATTCCATGGC
GTGCAAGGCCGGATCGTCTCTCATCGTGTTCGGCGGCGGGCCGGTGGGACTGGCGGCGGTCATGGCAGGCAAGGTCCGCG
AATGTTCGCAGATCATCCTGGTGGAACCAGTGGCCTCGCGGCGCGCGATTGCGCAGGAACTGGGGGCGACGCATGTGATC
GATCCCGCCGATGGCGATCTGGGCGAGGCTATCCGCGCGATCCTGCCGCTGGGCGTGGATGCCGCGCTCGATACCACGGG
CAATGTCGCGGTGATCGAAACCGGGCTGGGCAATCTCGCGCCGCACGGAATCATCGGTCTGGTCGGCGTACCCAGGGACA
TGACCGCTTCGGTTACCTTCAACATCGCGGCGTTGATGACGCCGGGCTTGCGCATCATCGGCATCATCGAAGGCGATGCC
GTGCCGCAGGATTTCATCCCCGAACTTCTCGCGTTGAATGCGCAAGGGCGGTTCCCGTTCGAACGGATGGTGCAGACCTT
CCCGCTTTCCCGCATCAACGAGGCGATCGACGCGCAGGCGCGCGGCGACTGCATCAAGGTCGTCCTCATCCCCTGA

Upstream 100 bases:

>100_bases
AGCAGGCCGAGGTGACAGCTTCGCCGGAGGGGGAAGCAGTGCTTGACGTCGTGCTCGACGGCCGGATCGAGATCATCGTG
GAACCCTTGGAGAATCTGGC

Downstream 100 bases:

>100_bases
TCCGCGAGATACCAGGAGCAAAACGATGGAATTCAACAACAATTATCACATGCTGATCGGTGGAGAACTTGTCGCCGCCG
AAGCCCGCCTGGACGTCGTG

Product: alcohol dehydrogenase

Products: NA

Alternate protein names: Benzyl alcohol dehydrogenase; BADH [H]

Number of amino acids: Translated: 371; Mature: 370

Protein sequence:

>371_residues
MTTCCAAVARGANQPFTIEQLTVDGPRAGEVLVQIAGVGLCHTDLVFRDQFDAFAKPGVLGHEGAGVIEAVGEGVTGLAA
GDRVVLGFSSCGECARCAEDLPSYCVQFVPLNYAGMRLDDGSTAHAAHDGERVSSHFFGQSSFATLAVTRARNVVKVPDS
TTVPLELLGPLGCGLMTGAGAVMNSMACKAGSSLIVFGGGPVGLAAVMAGKVRECSQIILVEPVASRRAIAQELGATHVI
DPADGDLGEAIRAILPLGVDAALDTTGNVAVIETGLGNLAPHGIIGLVGVPRDMTASVTFNIAALMTPGLRIIGIIEGDA
VPQDFIPELLALNAQGRFPFERMVQTFPLSRINEAIDAQARGDCIKVVLIP

Sequences:

>Translated_371_residues
MTTCCAAVARGANQPFTIEQLTVDGPRAGEVLVQIAGVGLCHTDLVFRDQFDAFAKPGVLGHEGAGVIEAVGEGVTGLAA
GDRVVLGFSSCGECARCAEDLPSYCVQFVPLNYAGMRLDDGSTAHAAHDGERVSSHFFGQSSFATLAVTRARNVVKVPDS
TTVPLELLGPLGCGLMTGAGAVMNSMACKAGSSLIVFGGGPVGLAAVMAGKVRECSQIILVEPVASRRAIAQELGATHVI
DPADGDLGEAIRAILPLGVDAALDTTGNVAVIETGLGNLAPHGIIGLVGVPRDMTASVTFNIAALMTPGLRIIGIIEGDA
VPQDFIPELLALNAQGRFPFERMVQTFPLSRINEAIDAQARGDCIKVVLIP
>Mature_370_residues
TTCCAAVARGANQPFTIEQLTVDGPRAGEVLVQIAGVGLCHTDLVFRDQFDAFAKPGVLGHEGAGVIEAVGEGVTGLAAG
DRVVLGFSSCGECARCAEDLPSYCVQFVPLNYAGMRLDDGSTAHAAHDGERVSSHFFGQSSFATLAVTRARNVVKVPDST
TVPLELLGPLGCGLMTGAGAVMNSMACKAGSSLIVFGGGPVGLAAVMAGKVRECSQIILVEPVASRRAIAQELGATHVID
PADGDLGEAIRAILPLGVDAALDTTGNVAVIETGLGNLAPHGIIGLVGVPRDMTASVTFNIAALMTPGLRIIGIIEGDAV
PQDFIPELLALNAQGRFPFERMVQTFPLSRINEAIDAQARGDCIKVVLIP

Specific function: Oxidizes primary alcohols with an aromatic or cyclohex- 1-ene ring. It is highly specific for benzyl alcohol [H]

COG id: COG1062

COG function: function code C; Zn-dependent alcohol dehydrogenases, class III

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the zinc-containing alcohol dehydrogenase family [H]

Homologues:

Organism=Homo sapiens, GI156523966, Length=376, Percent_Identity=32.1808510638298, Blast_Score=174, Evalue=2e-43,
Organism=Homo sapiens, GI71565152, Length=375, Percent_Identity=33.3333333333333, Blast_Score=172, Evalue=3e-43,
Organism=Homo sapiens, GI4501929, Length=374, Percent_Identity=32.8877005347594, Blast_Score=169, Evalue=4e-42,
Organism=Homo sapiens, GI34577061, Length=373, Percent_Identity=33.7801608579088, Blast_Score=167, Evalue=1e-41,
Organism=Homo sapiens, GI4501939, Length=369, Percent_Identity=31.9783197831978, Blast_Score=165, Evalue=6e-41,
Organism=Homo sapiens, GI4501933, Length=373, Percent_Identity=32.9758713136729, Blast_Score=159, Evalue=3e-39,
Organism=Homo sapiens, GI71565154, Length=373, Percent_Identity=32.171581769437, Blast_Score=150, Evalue=2e-36,
Organism=Homo sapiens, GI262073058, Length=376, Percent_Identity=30.3191489361702, Blast_Score=139, Evalue=3e-33,
Organism=Homo sapiens, GI71743840, Length=376, Percent_Identity=30.3191489361702, Blast_Score=139, Evalue=3e-33,
Organism=Escherichia coli, GI1786552, Length=376, Percent_Identity=31.6489361702128, Blast_Score=120, Evalue=2e-28,
Organism=Escherichia coli, GI87082125, Length=383, Percent_Identity=27.4151436031332, Blast_Score=90, Evalue=2e-19,
Organism=Escherichia coli, GI1787863, Length=366, Percent_Identity=26.5027322404372, Blast_Score=86, Evalue=4e-18,
Organism=Escherichia coli, GI1788407, Length=292, Percent_Identity=25.3424657534247, Blast_Score=76, Evalue=4e-15,
Organism=Caenorhabditis elegans, GI25146526, Length=384, Percent_Identity=32.5520833333333, Blast_Score=160, Evalue=1e-39,
Organism=Caenorhabditis elegans, GI71997431, Length=386, Percent_Identity=32.6424870466321, Blast_Score=157, Evalue=1e-38,
Organism=Caenorhabditis elegans, GI17565904, Length=355, Percent_Identity=30.4225352112676, Blast_Score=125, Evalue=3e-29,
Organism=Saccharomyces cerevisiae, GI6320033, Length=380, Percent_Identity=30, Blast_Score=150, Evalue=3e-37,
Organism=Saccharomyces cerevisiae, GI6319257, Length=274, Percent_Identity=26.2773722627737, Blast_Score=67, Evalue=4e-12,
Organism=Drosophila melanogaster, GI17737895, Length=384, Percent_Identity=32.03125, Blast_Score=156, Evalue=2e-38,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR013149
- InterPro:   IPR013154
- InterPro:   IPR002085
- InterPro:   IPR002328
- InterPro:   IPR011032
- InterPro:   IPR016040 [H]

Pfam domain/function: PF08240 ADH_N; PF00107 ADH_zinc_N [H]

EC number: =1.1.1.90 [H]

Molecular weight: Translated: 38180; Mature: 38049

Theoretical pI: Translated: 4.65; Mature: 4.65

Prosite motif: PS00059 ADH_ZINC

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

3.0 %Cys     (Translated Protein)
2.4 %Met     (Translated Protein)
5.4 %Cys+Met (Translated Protein)
3.0 %Cys     (Mature Protein)
2.2 %Met     (Mature Protein)
5.1 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MTTCCAAVARGANQPFTIEQLTVDGPRAGEVLVQIAGVGLCHTDLVFRDQFDAFAKPGVL
CCHHHHHHHCCCCCCEEEEEEEECCCCCCHHHHHHHCCCEEHHHHHHHHHHHHHCCCCCC
GHEGAGVIEAVGEGVTGLAAGDRVVLGFSSCGECARCAEDLPSYCVQFVPLNYAGMRLDD
CCCCCCHHHHHCCCCEEECCCCEEEEECCCCCHHHHHHHHHHHHHHHHCCCCCCCEEECC
GSTAHAAHDGERVSSHFFGQSSFATLAVTRARNVVKVPDSTTVPLELLGPLGCGLMTGAG
CCCCCCCCCCHHHHHHHCCCCCHHEEEEECCCCEEECCCCCCCCHHHHCCCCCHHHHCHH
AVMNSMACKAGSSLIVFGGGPVGLAAVMAGKVRECSQIILVEPVASRRAIAQELGATHVI
HHHHHHHHCCCCEEEEECCCHHHHHHHHHHHHHHCCEEEEECCHHHHHHHHHHHCCCEEE
DPADGDLGEAIRAILPLGVDAALDTTGNVAVIETGLGNLAPHGIIGLVGVPRDMTASVTF
CCCCCCHHHHHHHHHCCCCCCCCCCCCCEEEEECCCCCCCCCCEEEEEECCCCCEEEEEE
NIAALMTPGLRIIGIIEGDAVPQDFIPELLALNAQGRFPFERMVQTFPLSRINEAIDAQA
EEEEECCCCEEEEEEEECCCCCHHHHHHHHEECCCCCCCHHHHHHHCCHHHHHHHHCCCC
RGDCIKVVLIP
CCCEEEEEEEC
>Mature Secondary Structure 
TTCCAAVARGANQPFTIEQLTVDGPRAGEVLVQIAGVGLCHTDLVFRDQFDAFAKPGVL
CHHHHHHHCCCCCCEEEEEEEECCCCCCHHHHHHHCCCEEHHHHHHHHHHHHHCCCCCC
GHEGAGVIEAVGEGVTGLAAGDRVVLGFSSCGECARCAEDLPSYCVQFVPLNYAGMRLDD
CCCCCCHHHHHCCCCEEECCCCEEEEECCCCCHHHHHHHHHHHHHHHHCCCCCCCEEECC
GSTAHAAHDGERVSSHFFGQSSFATLAVTRARNVVKVPDSTTVPLELLGPLGCGLMTGAG
CCCCCCCCCCHHHHHHHCCCCCHHEEEEECCCCEEECCCCCCCCHHHHCCCCCHHHHCHH
AVMNSMACKAGSSLIVFGGGPVGLAAVMAGKVRECSQIILVEPVASRRAIAQELGATHVI
HHHHHHHHCCCCEEEEECCCHHHHHHHHHHHHHHCCEEEEECCHHHHHHHHHHHCCCEEE
DPADGDLGEAIRAILPLGVDAALDTTGNVAVIETGLGNLAPHGIIGLVGVPRDMTASVTF
CCCCCCHHHHHHHHHCCCCCCCCCCCCCEEEEECCCCCCCCCCEEEEEECCCCCEEEEEE
NIAALMTPGLRIIGIIEGDAVPQDFIPELLALNAQGRFPFERMVQTFPLSRINEAIDAQA
EEEEECCCCEEEEEEEECCCCCHHHHHHHHEECCCCCCCHHHHHHHCCHHHHHHHHCCCC
RGDCIKVVLIP
CCCEEEEEEEC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: 8496150; 1989592 [H]