Definition Burkholderia pseudomallei 1710b chromosome chromosome II, complete sequence.
Accession NC_007435
Length 3,181,762

Click here to switch to the map view.

The map label for this gene is 76818031

Identifier: 76818031

GI number: 76818031

Start: 92684

End: 93832

Strand: Direct

Name: 76818031

Synonym: BURPS1710b_A0070

Alternate gene names: NA

Gene position: 92684-93832 (Clockwise)

Preceding gene: 76819685

Following gene: 76819167

Centisome position: 2.91

GC content: 69.02

Gene sequence:

>1149_bases
ATGCTGACATCGCATTCCGATCATCTGCAGATCGACTGGGAAACCGGCCGATCGAGCCGCTATCACTGGGTATGGCTGCG
CCAGGCTTGCGAGTGCGCGGACTGCTTCAACGCCCATTGCCGGCAGCGCCGCTTCGATCCGGCCGCGATCGCGCCCGGCA
TCCGGCCCGAGCGCGTGTTGCTCGACGCGCACGGGGTGCGCATCGTCTGGCAGGACGCGCACGTGAGCACGTACGCGCTC
GAGCGGCTCGCGCGCGACGACTACCGCGAGGCGATTCCCCCCGCCGCGGCGGCGGGCTGGACGCCGTGGCCCGAGCGCGG
CGCGCCGTCGGCGAGCCATTTCGCGATCGGCGACGTGCTGGACAGCGACGCCGCGCTGCGGCGCGCGCTGAACCAACTGT
TCGAATCGGGCCTCGTCGTGCTGAAGGCGGGCGACGGCGCGGCGCCGCCTTTCGACGCGGTTCGCGAGCGGCTCGCGGGC
TTTCTCGAGCCGTCGTATTTCGGCGACTTCTTCGATCTCGAAGTCAAGGCGGACGACGCGACCGACAGCGTATCGTTCAG
CACGAGCGCGCTGCCGCTGCACACCGACATTCCGTACTGTTCGCCGCCGCCCGACTACCAGTTCCTGTACGGCCTCGACG
TCGATCCGCGTTGCGCGCGCGAGCAAGTGGGCTGCACGCGCTTCGTCGACGGCTGGGCGGTGCTGCGCGAATTGCGCGAC
GCGTCGCCGGAGATGTTCGAGCGCCTCGCGCGCACGCGCGTCGTCTACCGCGCCGACTATCCGGGCGCGCGCAAGCGCTA
CGAGCATCGAACGCCGATCGTCAGGCTGCGGGCGGACGGCACGGTCGAGCGGCTCATCAACAATCCGACGAAGATGTTCT
TCGACGGCATCGGCTTCGACGAACTGATGCCGTTCTTTCGCGCGTACCACGCGTTCAAGGCGCGCCTCGTCGCGACGATG
CGCTCGTATCTGCATGCATGGACGCAGGGCGACATGGTCGTCTGGGACAACCGGCGGATCTTTCACGGACGAGGCGATTT
CGGCGCGCCCGGCATCGTTCGCACGCTGCGCGGCGGGTACTTCAGGGAAGGCGAACTGCGCGCGCGCGACGCGTTTCTCG
CCGCGGCCGGCGAACGCGCAGCGGGTTGA

Upstream 100 bases:

>100_bases
AAGGGTGCCTGCTGCAAGGGCTGTTCGTCGCGCAGCGACGCTGACCGACGCTGACCGACGCGGCCAGGCCGCGCACCCCT
CACGCCAGCAGGAGCCCGAC

Downstream 100 bases:

>100_bases
GCGGGCGAGCGATCGCCCGACGCGTCGGGCGACGGGCGACGCGTCGCCCGCGCGCGTTCACGCTCGCCGCCAGCGTGGCC
GGCTCGGCTGGCATCGGACC

Product: putative gamma-butyrobetaine,2-oxoglutarate dioxygenase

Products: NA

Alternate protein names: Gamma-butyrobetaine hydroxylase; Gamma-BBH; Gamma-butyrobetaine,2-oxoglutarate dioxygenase [H]

Number of amino acids: Translated: 382; Mature: 382

Protein sequence:

>382_residues
MLTSHSDHLQIDWETGRSSRYHWVWLRQACECADCFNAHCRQRRFDPAAIAPGIRPERVLLDAHGVRIVWQDAHVSTYAL
ERLARDDYREAIPPAAAAGWTPWPERGAPSASHFAIGDVLDSDAALRRALNQLFESGLVVLKAGDGAAPPFDAVRERLAG
FLEPSYFGDFFDLEVKADDATDSVSFSTSALPLHTDIPYCSPPPDYQFLYGLDVDPRCAREQVGCTRFVDGWAVLRELRD
ASPEMFERLARTRVVYRADYPGARKRYEHRTPIVRLRADGTVERLINNPTKMFFDGIGFDELMPFFRAYHAFKARLVATM
RSYLHAWTQGDMVVWDNRRIFHGRGDFGAPGIVRTLRGGYFREGELRARDAFLAAAGERAAG

Sequences:

>Translated_382_residues
MLTSHSDHLQIDWETGRSSRYHWVWLRQACECADCFNAHCRQRRFDPAAIAPGIRPERVLLDAHGVRIVWQDAHVSTYAL
ERLARDDYREAIPPAAAAGWTPWPERGAPSASHFAIGDVLDSDAALRRALNQLFESGLVVLKAGDGAAPPFDAVRERLAG
FLEPSYFGDFFDLEVKADDATDSVSFSTSALPLHTDIPYCSPPPDYQFLYGLDVDPRCAREQVGCTRFVDGWAVLRELRD
ASPEMFERLARTRVVYRADYPGARKRYEHRTPIVRLRADGTVERLINNPTKMFFDGIGFDELMPFFRAYHAFKARLVATM
RSYLHAWTQGDMVVWDNRRIFHGRGDFGAPGIVRTLRGGYFREGELRARDAFLAAAGERAAG
>Mature_382_residues
MLTSHSDHLQIDWETGRSSRYHWVWLRQACECADCFNAHCRQRRFDPAAIAPGIRPERVLLDAHGVRIVWQDAHVSTYAL
ERLARDDYREAIPPAAAAGWTPWPERGAPSASHFAIGDVLDSDAALRRALNQLFESGLVVLKAGDGAAPPFDAVRERLAG
FLEPSYFGDFFDLEVKADDATDSVSFSTSALPLHTDIPYCSPPPDYQFLYGLDVDPRCAREQVGCTRFVDGWAVLRELRD
ASPEMFERLARTRVVYRADYPGARKRYEHRTPIVRLRADGTVERLINNPTKMFFDGIGFDELMPFFRAYHAFKARLVATM
RSYLHAWTQGDMVVWDNRRIFHGRGDFGAPGIVRTLRGGYFREGELRARDAFLAAAGERAAG

Specific function: Catalyzes the formation of L-carnitine from gamma- butyrobetaine [H]

COG id: COG2175

COG function: function code Q; Probable taurine catabolism dioxygenase

Gene ontology:

Cell location: Cytoplasm [H]

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Belongs to the gamma-BBH/TMLD family [H]

Homologues:

Organism=Homo sapiens, GI4502369, Length=368, Percent_Identity=26.9021739130435, Blast_Score=119, Evalue=5e-27,
Organism=Homo sapiens, GI8922625, Length=369, Percent_Identity=22.7642276422764, Blast_Score=97, Evalue=2e-20,
Organism=Homo sapiens, GI296317249, Length=256, Percent_Identity=24.21875, Blast_Score=88, Evalue=2e-17,
Organism=Caenorhabditis elegans, GI17534641, Length=388, Percent_Identity=24.4845360824742, Blast_Score=102, Evalue=3e-22,
Organism=Caenorhabditis elegans, GI71992672, Length=403, Percent_Identity=22.3325062034739, Blast_Score=80, Evalue=1e-15,
Organism=Drosophila melanogaster, GI24639015, Length=374, Percent_Identity=28.6096256684492, Blast_Score=130, Evalue=2e-30,
Organism=Drosophila melanogaster, GI221329931, Length=349, Percent_Identity=28.6532951289398, Blast_Score=109, Evalue=4e-24,
Organism=Drosophila melanogaster, GI24648401, Length=368, Percent_Identity=23.6413043478261, Blast_Score=96, Evalue=6e-20,
Organism=Drosophila melanogaster, GI19922166, Length=341, Percent_Identity=24.633431085044, Blast_Score=82, Evalue=6e-16,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR012775
- InterPro:   IPR010376
- InterPro:   IPR003819 [H]

Pfam domain/function: PF06155 DUF971; PF02668 TauD [H]

EC number: =1.14.11.1 [H]

Molecular weight: Translated: 43186; Mature: 43186

Theoretical pI: Translated: 6.95; Mature: 6.95

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.8 %Cys     (Translated Protein)
1.6 %Met     (Translated Protein)
3.4 %Cys+Met (Translated Protein)
1.8 %Cys     (Mature Protein)
1.6 %Met     (Mature Protein)
3.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MLTSHSDHLQIDWETGRSSRYHWVWLRQACECADCFNAHCRQRRFDPAAIAPGIRPERVL
CCCCCCCCEEEEEECCCCCCEEEEEHHHHHHHHHHHHHHHHHCCCCCHHCCCCCCCCEEE
LDAHGVRIVWQDAHVSTYALERLARDDYREAIPPAAAAGWTPWPERGAPSASHFAIGDVL
EECCCEEEEEECCCHHHHHHHHHHHHHHHHHCCCCHHCCCCCCCCCCCCCCCCEEHHHHH
DSDAALRRALNQLFESGLVVLKAGDGAAPPFDAVRERLAGFLEPSYFGDFFDLEVKADDA
CCHHHHHHHHHHHHHCCEEEEECCCCCCCCHHHHHHHHHHHCCHHHCCCEEEEEEECCCC
TDSVSFSTSALPLHTDIPYCSPPPDYQFLYGLDVDPRCAREQVGCTRFVDGWAVLRELRD
CCCCCCCCCCCEEECCCCCCCCCCCCCEEEECCCCCHHHHHHCCHHHHHHHHHHHHHHHC
ASPEMFERLARTRVVYRADYPGARKRYEHRTPIVRLRADGTVERLINNPTKMFFDGIGFD
CCHHHHHHHHHHEEEEECCCCCHHHHHHCCCCEEEEECCCHHHHHHCCCHHHHCCCCCHH
ELMPFFRAYHAFKARLVATMRSYLHAWTQGDMVVWDNRRIFHGRGDFGAPGIVRTLRGGY
HHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEECCCEEEECCCCCCCCHHHHHHCCCC
FREGELRARDAFLAAAGERAAG
CCCCCCHHHHHHHHHCCCCCCC
>Mature Secondary Structure
MLTSHSDHLQIDWETGRSSRYHWVWLRQACECADCFNAHCRQRRFDPAAIAPGIRPERVL
CCCCCCCCEEEEEECCCCCCEEEEEHHHHHHHHHHHHHHHHHCCCCCHHCCCCCCCCEEE
LDAHGVRIVWQDAHVSTYALERLARDDYREAIPPAAAAGWTPWPERGAPSASHFAIGDVL
EECCCEEEEEECCCHHHHHHHHHHHHHHHHHCCCCHHCCCCCCCCCCCCCCCCEEHHHHH
DSDAALRRALNQLFESGLVVLKAGDGAAPPFDAVRERLAGFLEPSYFGDFFDLEVKADDA
CCHHHHHHHHHHHHHCCEEEEECCCCCCCCHHHHHHHHHHHCCHHHCCCEEEEEEECCCC
TDSVSFSTSALPLHTDIPYCSPPPDYQFLYGLDVDPRCAREQVGCTRFVDGWAVLRELRD
CCCCCCCCCCCEEECCCCCCCCCCCCCEEEECCCCCHHHHHHCCHHHHHHHHHHHHHHHC
ASPEMFERLARTRVVYRADYPGARKRYEHRTPIVRLRADGTVERLINNPTKMFFDGIGFD
CCHHHHHHHHHHEEEEECCCCCHHHHHHCCCCEEEEECCCHHHHHHCCCHHHHCCCCCHH
ELMPFFRAYHAFKARLVATMRSYLHAWTQGDMVVWDNRRIFHGRGDFGAPGIVRTLRGGY
HHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEECCCEEEECCCCCCCCHHHHHHCCCC
FREGELRARDAFLAAAGERAAG
CCCCCCHHHHHHHHHCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 8504802 [H]