Definition Burkholderia sp. 383 chromosome 1, complete genome.
Accession NC_007510
Length 3,694,126

Click here to switch to the map view.

The map label for this gene is chb [H]

Identifier: 78067619

GI number: 78067619

Start: 3293484

End: 3295967

Strand: Direct

Name: chb [H]

Synonym: Bcep18194_A6150

Alternate gene names: 78067619

Gene position: 3293484-3295967 (Clockwise)

Preceding gene: 78067618

Following gene: 78067631

Centisome position: 89.15

GC content: 70.65

Gene sequence:

>2484_bases
ATGAACAGAACCTTGTCCACCCTGTTTGCCGGCCTGCTGATCGCGGCACTGTCGCCGGTCGCGCACGGCGCGCTGCCCGC
GTCGAGCGCGGCGGCCGCGACGGCCGGCGCCGTCCGTCCACCCGTGCCGCCGGCCGATCTCGCGGCGCGGCTGTCGAACG
GCCTCGCGCTGCGCGTCGCCGTCGACAACAATCACGCGGCCGCGGCCGGCGTGCCGTGCGCCGATCTCGGCGCCGACGGC
GCGGCCTGCGCGACGGGCCGCCTGATCCTGCAGAACCGCGGCCACCAGGCGATCGCCGACGGCGGCTGGAAGCTCTACCT
GCACAGCATCCGCCGCCTGCTGCGGATCGACCGCCCCGGCTTCGCGCTGCGGCGGCTCACCGGCGACCTGTACGAACTGA
CGCCGCAACCGGGCTCGGTGCGGCTGGCACCGGGCGAGCGCATCGAGCTGCCGTTCGTCGCCGAATACTGGTTGCTGCGG
TACAGCGACGTGATCCCGCGCCCGTACGTGGTCGTCGATGGCGCGCCGCCCGCCGTGCTCCGCTACAACGACACCGACGA
CGAGCTGCGCTACGTCGAATCGCTGCCGGCCGACGCGCAGAACAACTCGACCGGCAATGCGCCGCCCGTGGCCGCACGAC
CCGATGCGAGCCGCGCGCTGCCGAGCGTGAAGCGCGAGCAGCCGCTGCCCGGCATGCTCGACCTGCGCGGCGTCGAGCTC
GCGTTGCCCGATCTGCCGGACGCTCAAGTCGCGGCGCTGCGCGAGCGCGCGACGACACTCGGGCTCGACGGCGCGCGCGT
GCCGGTGCGTGGTGCCGTCGCGCCGCGCCGGCTGCCGGCCGATATCGCGACGCCGGGCGGCTACCGGCTCGCGATCGGGC
CGCGCGGCGTGCTGATCGAAGGCTACGATCGCGCCGGCCTCTACTACGGCGTACAGACGCTCTACTCGCTCGCCCCCGCC
GGCGGCGGCCCGATCCCGGCGATGCTCGTCGAAGATGCACCGCGCTTCACGCATCGCGGGATGCACGTCGATCTCGCCCG
TAACTTCAAGCACCCGGCGACGCTGCGCCGCCTGATCGACCAGATGAGCGCATACAAGCTCAATCGCCTGCACCTGCACC
TGTCCGACGACGAGGGCTGGCGCATCGAGATTCCCGGCCTGCCCGAACTGACCGGGATCGGGGGACGCCGCTGCCACGAT
CCGAGCGAGACGCGCTGCCTGCTGCCGCAGCTCGGCTCCGGCCCCGACAACCGCTCGGGCGGAGGCTACCTGACGCGTGA
TGACTACGTGTCGCTGGTGCGCTACGCGGCCGCGCATTTCGTCGAGATCATCCCCGAGATCGACATGCCCGCGCATGCAC
GCGCGGCCGTCGTGACGATGGAAGCACGTTACCAGCGGCTGCATGCGGCCGGCCGCGAGCAGGAAGCGAACGCATACCGG
CTGCTCGATCCGCAGGACACGTCGAACCTGACGACGGTGCAGTTCTACGACCGGCGCAGCGACCTGAACCCGTGCGTGCC
GGGCGCGCTCAATTTCGCGTCGAAGGTGATCCGCGAGATCGCCGCGATGCATGCGGACGCGCAGGCGCCGCTGCACACCT
GGCATTACGGCGGCGACGAGGCGAAGAACATCTTCCTCGGCGCGGGCTTCCAGCCGCTGAACGGTACCGATCCGAACAAG
GGGCGCATCGATCTCGCCGCGCAGGACAAGCCGTGGGCGCGTTCGCCCGCGTGCACGGCACTGCTCCAGCGCGGCGAGAT
CAAGTCGATCGACGAGCTGCCGACGCGTTTCGCGCAACAGGTGAGCGCGGCGGTCAACGCGAACGGGATCGACACGATGG
CCGCATGGCAGGACGGCATCAAGCATGCGAACGGGCCGCAGGACTTCAGCACGCGCCACGTGATGGTGTCGCTGTGGGAC
ACGATCTTCTGGGGGGCATCGGATAGCGCACGCGACCTGAGCGGCAAGGGCTACCTGACGGTGCTGGCCCTGCCCGACTA
CCTGTATTTCGACTTCCCGTACACGCTCAACCCGCGCGAGCGCGGCTACTACTGGGGCTCGCACGCGACGGACGAGTACA
AGGTGTTCTCGCTCGCGCCCGAGAACCTGCCGCAGAACGCCGAAGTGATGGGCGACCGTGACGGCAACACGTTCGAGGTG
ACGGGCACGGGCCCCGCGCCGCGCATCGAAGGCATGCAGGGGCAGGCGTGGGGCGAGGTGATGCGCAACGACACCTTCCT
CGAGTACATGGCCTATCCGCGGCTGCTCGCGCTCGCCGAGCGCGCGTGGCACCGGGCCGACTGGGAGCTGCCGTATGCGG
CCGGCGTGCGCTTCAAGCGCGGCGACACGCATCATGTCGACACGGCCGCGCTGCAGCGCGACTGGGCCGGCTTCGCGACG
CTGCTCACGCAACGCGAACTGCCGAAGCTCGACCGGGCCGGCGTCGGCTACCGGAAGCCGACCTTCACGCTGACGAATCC
GTGA

Upstream 100 bases:

>100_bases
GCCCGCGCACCCTGTTGTCCCCGCAGCTCCGTTGAAAGACCCGCTCGCAGCGACGTCATCCCGTGACGCCGCTATGCCCC
CTTTTTTCTCAGGAGTCCGC

Downstream 100 bases:

>100_bases
ACGGCTGAGCGACCAGGCGATGCGCGATGCAGGCGGGCGCATCGCACCCTCCATTGCCCGCACCAAAGAAAAACGGCTTG
CGACGCATCGCAAGCCGTTT

Product: Beta-N-acetylhexosaminidase

Products: NA

Alternate protein names: Beta-N-acetylhexosaminidase; N-acetyl-beta-glucosaminidase [H]

Number of amino acids: Translated: 827; Mature: 827

Protein sequence:

>827_residues
MNRTLSTLFAGLLIAALSPVAHGALPASSAAAATAGAVRPPVPPADLAARLSNGLALRVAVDNNHAAAAGVPCADLGADG
AACATGRLILQNRGHQAIADGGWKLYLHSIRRLLRIDRPGFALRRLTGDLYELTPQPGSVRLAPGERIELPFVAEYWLLR
YSDVIPRPYVVVDGAPPAVLRYNDTDDELRYVESLPADAQNNSTGNAPPVAARPDASRALPSVKREQPLPGMLDLRGVEL
ALPDLPDAQVAALRERATTLGLDGARVPVRGAVAPRRLPADIATPGGYRLAIGPRGVLIEGYDRAGLYYGVQTLYSLAPA
GGGPIPAMLVEDAPRFTHRGMHVDLARNFKHPATLRRLIDQMSAYKLNRLHLHLSDDEGWRIEIPGLPELTGIGGRRCHD
PSETRCLLPQLGSGPDNRSGGGYLTRDDYVSLVRYAAAHFVEIIPEIDMPAHARAAVVTMEARYQRLHAAGREQEANAYR
LLDPQDTSNLTTVQFYDRRSDLNPCVPGALNFASKVIREIAAMHADAQAPLHTWHYGGDEAKNIFLGAGFQPLNGTDPNK
GRIDLAAQDKPWARSPACTALLQRGEIKSIDELPTRFAQQVSAAVNANGIDTMAAWQDGIKHANGPQDFSTRHVMVSLWD
TIFWGASDSARDLSGKGYLTVLALPDYLYFDFPYTLNPRERGYYWGSHATDEYKVFSLAPENLPQNAEVMGDRDGNTFEV
TGTGPAPRIEGMQGQAWGEVMRNDTFLEYMAYPRLLALAERAWHRADWELPYAAGVRFKRGDTHHVDTAALQRDWAGFAT
LLTQRELPKLDRAGVGYRKPTFTLTNP

Sequences:

>Translated_827_residues
MNRTLSTLFAGLLIAALSPVAHGALPASSAAAATAGAVRPPVPPADLAARLSNGLALRVAVDNNHAAAAGVPCADLGADG
AACATGRLILQNRGHQAIADGGWKLYLHSIRRLLRIDRPGFALRRLTGDLYELTPQPGSVRLAPGERIELPFVAEYWLLR
YSDVIPRPYVVVDGAPPAVLRYNDTDDELRYVESLPADAQNNSTGNAPPVAARPDASRALPSVKREQPLPGMLDLRGVEL
ALPDLPDAQVAALRERATTLGLDGARVPVRGAVAPRRLPADIATPGGYRLAIGPRGVLIEGYDRAGLYYGVQTLYSLAPA
GGGPIPAMLVEDAPRFTHRGMHVDLARNFKHPATLRRLIDQMSAYKLNRLHLHLSDDEGWRIEIPGLPELTGIGGRRCHD
PSETRCLLPQLGSGPDNRSGGGYLTRDDYVSLVRYAAAHFVEIIPEIDMPAHARAAVVTMEARYQRLHAAGREQEANAYR
LLDPQDTSNLTTVQFYDRRSDLNPCVPGALNFASKVIREIAAMHADAQAPLHTWHYGGDEAKNIFLGAGFQPLNGTDPNK
GRIDLAAQDKPWARSPACTALLQRGEIKSIDELPTRFAQQVSAAVNANGIDTMAAWQDGIKHANGPQDFSTRHVMVSLWD
TIFWGASDSARDLSGKGYLTVLALPDYLYFDFPYTLNPRERGYYWGSHATDEYKVFSLAPENLPQNAEVMGDRDGNTFEV
TGTGPAPRIEGMQGQAWGEVMRNDTFLEYMAYPRLLALAERAWHRADWELPYAAGVRFKRGDTHHVDTAALQRDWAGFAT
LLTQRELPKLDRAGVGYRKPTFTLTNP
>Mature_827_residues
MNRTLSTLFAGLLIAALSPVAHGALPASSAAAATAGAVRPPVPPADLAARLSNGLALRVAVDNNHAAAAGVPCADLGADG
AACATGRLILQNRGHQAIADGGWKLYLHSIRRLLRIDRPGFALRRLTGDLYELTPQPGSVRLAPGERIELPFVAEYWLLR
YSDVIPRPYVVVDGAPPAVLRYNDTDDELRYVESLPADAQNNSTGNAPPVAARPDASRALPSVKREQPLPGMLDLRGVEL
ALPDLPDAQVAALRERATTLGLDGARVPVRGAVAPRRLPADIATPGGYRLAIGPRGVLIEGYDRAGLYYGVQTLYSLAPA
GGGPIPAMLVEDAPRFTHRGMHVDLARNFKHPATLRRLIDQMSAYKLNRLHLHLSDDEGWRIEIPGLPELTGIGGRRCHD
PSETRCLLPQLGSGPDNRSGGGYLTRDDYVSLVRYAAAHFVEIIPEIDMPAHARAAVVTMEARYQRLHAAGREQEANAYR
LLDPQDTSNLTTVQFYDRRSDLNPCVPGALNFASKVIREIAAMHADAQAPLHTWHYGGDEAKNIFLGAGFQPLNGTDPNK
GRIDLAAQDKPWARSPACTALLQRGEIKSIDELPTRFAQQVSAAVNANGIDTMAAWQDGIKHANGPQDFSTRHVMVSLWD
TIFWGASDSARDLSGKGYLTVLALPDYLYFDFPYTLNPRERGYYWGSHATDEYKVFSLAPENLPQNAEVMGDRDGNTFEV
TGTGPAPRIEGMQGQAWGEVMRNDTFLEYMAYPRLLALAERAWHRADWELPYAAGVRFKRGDTHHVDTAALQRDWAGFAT
LLTQRELPKLDRAGVGYRKPTFTLTNP

Specific function: Digests the beta-1,4-glycosidic bonds in N- acetylglucosamine (GlcNAc) oligomers (mainly dimers) [H]

COG id: COG3525

COG function: function code G; N-acetyl-beta-hexosaminidase

Gene ontology:

Cell location: Periplasm [H]

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Belongs to the glycosyl hydrolase 20 family [H]

Homologues:

Organism=Drosophila melanogaster, GI17933586, Length=537, Percent_Identity=23.8361266294227, Blast_Score=76, Evalue=7e-14,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR015882
- InterPro:   IPR008965
- InterPro:   IPR004866
- InterPro:   IPR012291
- InterPro:   IPR013812
- InterPro:   IPR001540
- InterPro:   IPR004867
- InterPro:   IPR015883
- InterPro:   IPR017853
- InterPro:   IPR013781
- InterPro:   IPR014756 [H]

Pfam domain/function: PF03173 CHB_HEX; PF03174 CHB_HEX_C; PF00728 Glyco_hydro_20; PF02838 Glyco_hydro_20b [H]

EC number: =3.2.1.52 [H]

Molecular weight: Translated: 90192; Mature: 90192

Theoretical pI: Translated: 7.01; Mature: 7.01

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.7 %Cys     (Translated Protein)
1.7 %Met     (Translated Protein)
2.4 %Cys+Met (Translated Protein)
0.7 %Cys     (Mature Protein)
1.7 %Met     (Mature Protein)
2.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MNRTLSTLFAGLLIAALSPVAHGALPASSAAAATAGAVRPPVPPADLAARLSNGLALRVA
CCCHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHCCCCCCCCCHHHHHHHHCCCEEEEEE
VDNNHAAAAGVPCADLGADGAACATGRLILQNRGHQAIADGGWKLYLHSIRRLLRIDRPG
ECCCCCCCCCCCHHHCCCCCCHHHHCEEEEECCCCEEECCCCHHHHHHHHHHHHHCCCCC
FALRRLTGDLYELTPQPGSVRLAPGERIELPFVAEYWLLRYSDVIPRPYVVVDGAPPAVL
HHHHHHCCHHHEECCCCCCEEECCCCEECCCHHHHHHHHHHHHCCCCCEEEECCCCCEEE
RYNDTDDELRYVESLPADAQNNSTGNAPPVAARPDASRALPSVKREQPLPGMLDLRGVEL
EECCCHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCHHHHCCCHHHCCCCCCCEECCCCEE
ALPDLPDAQVAALRERATTLGLDGARVPVRGAVAPRRLPADIATPGGYRLAIGPRGVLIE
ECCCCCCHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCEEEEECCCEEEEE
GYDRAGLYYGVQTLYSLAPAGGGPIPAMLVEDAPRFTHRGMHVDLARNFKHPATLRRLID
CCCCCHHHHHHHHHHHHCCCCCCCCCCHHCCCCCCHHHCCEEEEHHHCCCCHHHHHHHHH
QMSAYKLNRLHLHLSDDEGWRIEIPGLPELTGIGGRRCHDPSETRCLLPQLGSGPDNRSG
HHHHCEEEEEEEEECCCCCCEEECCCCCCCCCCCCCCCCCCCCCEEECCCCCCCCCCCCC
GGYLTRDDYVSLVRYAAAHFVEIIPEIDMPAHARAAVVTMEARYQRLHAAGREQEANAYR
CCCCCHHHHHHHHHHHHHHHHHHHCCCCCCCCCCEEEEEHHHHHHHHHHCCCCCCCCEEE
LLDPQDTSNLTTVQFYDRRSDLNPCVPGALNFASKVIREIAAMHADAQAPLHTWHYGGDE
EECCCCCCCEEEEEEECCCCCCCCCCCHHHHHHHHHHHHHHHHHCCCCCCCEEEECCCCC
AKNIFLGAGFQPLNGTDPNKGRIDLAAQDKPWARSPACTALLQRGEIKSIDELPTRFAQQ
CCEEEEECCCCCCCCCCCCCCEEEEEECCCCCCCCHHHHHHHHCCCCCCHHHHHHHHHHH
VSAAVNANGIDTMAAWQDGIKHANGPQDFSTRHVMVSLWDTIFWGASDSARDLSGKGYLT
HHHHHCCCCCHHHHHHHHHHHCCCCCCCCCHHHHHHEEHHHHHCCCCCCCCCCCCCCCEE
VLALPDYLYFDFPYTLNPRERGYYWGSHATDEYKVFSLAPENLPQNAEVMGDRDGNTFEV
EEECCCEEEEECCEEECCCCCCEECCCCCCCCEEEEEECCCCCCCCCCEEECCCCCEEEE
TGTGPAPRIEGMQGQAWGEVMRNDTFLEYMAYPRLLALAERAWHRADWELPYAAGVRFKR
ECCCCCCCCCCCCCHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHCCEEEC
GDTHHVDTAALQRDWAGFATLLTQRELPKLDRAGVGYRKPTFTLTNP
CCCCCCHHHHHHHHHHHHHHHHHHHCCCCCHHCCCCCCCCEEEECCC
>Mature Secondary Structure
MNRTLSTLFAGLLIAALSPVAHGALPASSAAAATAGAVRPPVPPADLAARLSNGLALRVA
CCCHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHCCCCCCCCCHHHHHHHHCCCEEEEEE
VDNNHAAAAGVPCADLGADGAACATGRLILQNRGHQAIADGGWKLYLHSIRRLLRIDRPG
ECCCCCCCCCCCHHHCCCCCCHHHHCEEEEECCCCEEECCCCHHHHHHHHHHHHHCCCCC
FALRRLTGDLYELTPQPGSVRLAPGERIELPFVAEYWLLRYSDVIPRPYVVVDGAPPAVL
HHHHHHCCHHHEECCCCCCEEECCCCEECCCHHHHHHHHHHHHCCCCCEEEECCCCCEEE
RYNDTDDELRYVESLPADAQNNSTGNAPPVAARPDASRALPSVKREQPLPGMLDLRGVEL
EECCCHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCHHHHCCCHHHCCCCCCCEECCCCEE
ALPDLPDAQVAALRERATTLGLDGARVPVRGAVAPRRLPADIATPGGYRLAIGPRGVLIE
ECCCCCCHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCEEEEECCCEEEEE
GYDRAGLYYGVQTLYSLAPAGGGPIPAMLVEDAPRFTHRGMHVDLARNFKHPATLRRLID
CCCCCHHHHHHHHHHHHCCCCCCCCCCHHCCCCCCHHHCCEEEEHHHCCCCHHHHHHHHH
QMSAYKLNRLHLHLSDDEGWRIEIPGLPELTGIGGRRCHDPSETRCLLPQLGSGPDNRSG
HHHHCEEEEEEEEECCCCCCEEECCCCCCCCCCCCCCCCCCCCCEEECCCCCCCCCCCCC
GGYLTRDDYVSLVRYAAAHFVEIIPEIDMPAHARAAVVTMEARYQRLHAAGREQEANAYR
CCCCCHHHHHHHHHHHHHHHHHHHCCCCCCCCCCEEEEEHHHHHHHHHHCCCCCCCCEEE
LLDPQDTSNLTTVQFYDRRSDLNPCVPGALNFASKVIREIAAMHADAQAPLHTWHYGGDE
EECCCCCCCEEEEEEECCCCCCCCCCCHHHHHHHHHHHHHHHHHCCCCCCCEEEECCCCC
AKNIFLGAGFQPLNGTDPNKGRIDLAAQDKPWARSPACTALLQRGEIKSIDELPTRFAQQ
CCEEEEECCCCCCCCCCCCCCEEEEEECCCCCCCCHHHHHHHHCCCCCCHHHHHHHHHHH
VSAAVNANGIDTMAAWQDGIKHANGPQDFSTRHVMVSLWDTIFWGASDSARDLSGKGYLT
HHHHHCCCCCHHHHHHHHHHHCCCCCCCCCHHHHHHEEHHHHHCCCCCCCCCCCCCCCEE
VLALPDYLYFDFPYTLNPRERGYYWGSHATDEYKVFSLAPENLPQNAEVMGDRDGNTFEV
EEECCCEEEEECCEEECCCCCCEECCCCCCCCEEEEEECCCCCCCCCCEEECCCCCEEEE
TGTGPAPRIEGMQGQAWGEVMRNDTFLEYMAYPRLLALAERAWHRADWELPYAAGVRFKR
ECCCCCCCCCCCCCHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHCCEEEC
GDTHHVDTAALQRDWAGFATLLTQRELPKLDRAGVGYRKPTFTLTNP
CCCCCCHHHHHHHHHHHHHHHHHHHCCCCCHHCCCCCCCCEEEECCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 8621090; 8673609 [H]