Definition Burkholderia cenocepacia AU 1054 chromosome 1, complete sequence.
Accession NC_008060
Length 3,294,563

Click here to switch to the map view.

The map label for this gene is yfjD [H]

Identifier: 107021657

GI number: 107021657

Start: 101790

End: 103163

Strand: Reverse

Name: yfjD [H]

Synonym: Bcen_0097

Alternate gene names: 107021657

Gene position: 103163-101790 (Counterclockwise)

Preceding gene: 107021658

Following gene: 107021656

Centisome position: 3.13

GC content: 63.25

Gene sequence:

>1374_bases
TTGTATCGCGCGCGACACATCGCGGTCGCCGGCCTCTGCTATATTTCCCCCATCCCTGTCCTTCACTGCCCTTTCCAACG
CGTGGACCAAATTCCCTTATGGGCGCAAATCGGCGCCGTCTTCCTGCTTCTCCTCTGTTCCAGCTTCTTTTCCATTTCCG
AGACCGCGATGATGGCGCTCAATCGCCATCGGCTGAAGCATCTCGCCGGTCAGGGCGCACTCGGCGCGAAAACCACGCAG
GGGCTGCTCACGCGCACTGACTTGCTGCTCAGCGTGATCCTGATCGGCAACAATCTGTTCAACACGATCATCCCGGTCCT
CACGACGTCGCTCGCGCTCCATACGTTCGGCCGCAACAACCTCGCGCTGTCGATCGCGACCGGCGTCGTCGCGTTCCTGA
TCATCGTGTTCGCAGAAATCGCGCCGAAGATCGTCGGCGCGACGTTCCCCGAACGCATCGCGCTGCCGGCGAGCCTCGTG
ATCGCCCCGCTGATGCGCGTGTTCAAGCCGGTCGTCTGGTTCGTCAATGCGCTCGCGAACGGCGTGCTGTGGGTGCTGCG
CATCAACACGAAGAAGGGCCGCGACCAGCGGATGTCGGCCGACGAGCTGCGGGCCATCGTGCTCGAATCGAGCAGTTTCA
TGCCGACCAAGCACCGCAGCATCCTGCTGAATCTGTTCGACCTCGAGAACATCACGGTCGACGACGTGATGGTGCCGCGC
CGCCAGATCGAGTCGCTCAACTTCTACGCGCCGCTCGACGACATCCTGCATCAACTCGAAACCTGCTACCACAACCGCCT
GGTCGTCTACGAAGGCGACATCGACAAGGTGCTCGGCGTGCTGCACGTGCGCAAGACGCTCACCGGGCTACACAACCAGG
ATTTCGACCGCGAGACGCTGCGCGCGCTGCTCGCCGAACCGTATTACGTGCCGTCCGGCACGCCGGTGGTCCAGCAGCTC
CAGTTCTTCCAGGAAACCCGGCAGCGCACCGCGCTCGTCGTCAACGAGTACGGCGAACTCGAAGGGCTCGTCACGCCCGA
GGACATCATCGAGGAGCTGATCGGCGAATTCACGACGTCGATGCCGCGCAGCGAACGCGCGGGCGGCTGGGACGAGAACG
GCGAATGCATCGTCTCGGCCAGCATGCCGCTGCGCGAACTGAACCGCTGGCTGCACCTGAAGCTGCCGACCGACGGGCCG
AAGACGCTGAACGGACTGGTGCTCGAGATCCTCGAGGAAATTCCGGAAGACGACGTGTGCCTGAAAATCGGCGACGTGAT
GCTCGAAGTGATGCGCAGCGACGATCAGGCGGTGCGCACCGTCAAGCTCTTCAAGCCGCGGGGCACGCGTACCGGACGCA
CCGCCACGCGCTAA

Upstream 100 bases:

>100_bases
GGACGTAGAGGCCGGAGGTTCGAATCCTCTCACCCCGACCAGATTTAAAAAACCGTGCACCGTGTGCACGGTTTTTTTTC
GTCCGGCCGCCGCGAACCCC

Downstream 100 bases:

>100_bases
CCGAACGGCCGACTGCCGGTGCCGGCCGCGACGCGCGATCATCTGCGCATCACGGTCAACAGGCGGCCCGCGTGCCGGCT
CACATGCATTTCCCTTCCCC

Product: hypothetical protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 457; Mature: 457

Protein sequence:

>457_residues
MYRARHIAVAGLCYISPIPVLHCPFQRVDQIPLWAQIGAVFLLLLCSSFFSISETAMMALNRHRLKHLAGQGALGAKTTQ
GLLTRTDLLLSVILIGNNLFNTIIPVLTTSLALHTFGRNNLALSIATGVVAFLIIVFAEIAPKIVGATFPERIALPASLV
IAPLMRVFKPVVWFVNALANGVLWVLRINTKKGRDQRMSADELRAIVLESSSFMPTKHRSILLNLFDLENITVDDVMVPR
RQIESLNFYAPLDDILHQLETCYHNRLVVYEGDIDKVLGVLHVRKTLTGLHNQDFDRETLRALLAEPYYVPSGTPVVQQL
QFFQETRQRTALVVNEYGELEGLVTPEDIIEELIGEFTTSMPRSERAGGWDENGECIVSASMPLRELNRWLHLKLPTDGP
KTLNGLVLEILEEIPEDDVCLKIGDVMLEVMRSDDQAVRTVKLFKPRGTRTGRTATR

Sequences:

>Translated_457_residues
MYRARHIAVAGLCYISPIPVLHCPFQRVDQIPLWAQIGAVFLLLLCSSFFSISETAMMALNRHRLKHLAGQGALGAKTTQ
GLLTRTDLLLSVILIGNNLFNTIIPVLTTSLALHTFGRNNLALSIATGVVAFLIIVFAEIAPKIVGATFPERIALPASLV
IAPLMRVFKPVVWFVNALANGVLWVLRINTKKGRDQRMSADELRAIVLESSSFMPTKHRSILLNLFDLENITVDDVMVPR
RQIESLNFYAPLDDILHQLETCYHNRLVVYEGDIDKVLGVLHVRKTLTGLHNQDFDRETLRALLAEPYYVPSGTPVVQQL
QFFQETRQRTALVVNEYGELEGLVTPEDIIEELIGEFTTSMPRSERAGGWDENGECIVSASMPLRELNRWLHLKLPTDGP
KTLNGLVLEILEEIPEDDVCLKIGDVMLEVMRSDDQAVRTVKLFKPRGTRTGRTATR
>Mature_457_residues
MYRARHIAVAGLCYISPIPVLHCPFQRVDQIPLWAQIGAVFLLLLCSSFFSISETAMMALNRHRLKHLAGQGALGAKTTQ
GLLTRTDLLLSVILIGNNLFNTIIPVLTTSLALHTFGRNNLALSIATGVVAFLIIVFAEIAPKIVGATFPERIALPASLV
IAPLMRVFKPVVWFVNALANGVLWVLRINTKKGRDQRMSADELRAIVLESSSFMPTKHRSILLNLFDLENITVDDVMVPR
RQIESLNFYAPLDDILHQLETCYHNRLVVYEGDIDKVLGVLHVRKTLTGLHNQDFDRETLRALLAEPYYVPSGTPVVQQL
QFFQETRQRTALVVNEYGELEGLVTPEDIIEELIGEFTTSMPRSERAGGWDENGECIVSASMPLRELNRWLHLKLPTDGP
KTLNGLVLEILEEIPEDDVCLKIGDVMLEVMRSDDQAVRTVKLFKPRGTRTGRTATR

Specific function: Unknown

COG id: COG4536

COG function: function code P; Putative Mg2+ and Co2+ transporter CorB

Gene ontology:

Cell location: Cell inner membrane; Multi-pass membrane protein [H]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 2 CBS domains [H]

Homologues:

Organism=Homo sapiens, GI310128564, Length=346, Percent_Identity=24.5664739884393, Blast_Score=100, Evalue=3e-21,
Organism=Homo sapiens, GI40068055, Length=350, Percent_Identity=24.8571428571429, Blast_Score=71, Evalue=2e-12,
Organism=Homo sapiens, GI40068053, Length=350, Percent_Identity=24.8571428571429, Blast_Score=71, Evalue=2e-12,
Organism=Escherichia coli, GI145693175, Length=399, Percent_Identity=39.3483709273183, Blast_Score=306, Evalue=2e-84,
Organism=Escherichia coli, GI1790664, Length=417, Percent_Identity=24.7002398081535, Blast_Score=120, Evalue=1e-28,
Organism=Escherichia coli, GI87082033, Length=279, Percent_Identity=28.673835125448, Blast_Score=104, Evalue=9e-24,
Organism=Escherichia coli, GI1786879, Length=157, Percent_Identity=30.5732484076433, Blast_Score=71, Evalue=1e-13,
Organism=Escherichia coli, GI1788119, Length=234, Percent_Identity=23.5042735042735, Blast_Score=67, Evalue=3e-12,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR016169
- InterPro:   IPR000644
- InterPro:   IPR002550
- InterPro:   IPR005170 [H]

Pfam domain/function: PF00571 CBS; PF03471 CorC_HlyC; PF01595 DUF21 [H]

EC number: NA

Molecular weight: Translated: 51164; Mature: 51164

Theoretical pI: Translated: 6.90; Mature: 6.90

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.3 %Cys     (Translated Protein)
2.4 %Met     (Translated Protein)
3.7 %Cys+Met (Translated Protein)
1.3 %Cys     (Mature Protein)
2.4 %Met     (Mature Protein)
3.7 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MYRARHIAVAGLCYISPIPVLHCPFQRVDQIPLWAQIGAVFLLLLCSSFFSISETAMMAL
CCCCHHHHHHHHHHHCCCCCEECCHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHH
NRHRLKHLAGQGALGAKTTQGLLTRTDLLLSVILIGNNLFNTIIPVLTTSLALHTFGRNN
HHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHCCCCC
LALSIATGVVAFLIIVFAEIAPKIVGATFPERIALPASLVIAPLMRVFKPVVWFVNALAN
EEEEHHHHHHHHHHHHHHHHHHHHHCCCCCHHHCCCHHHHHHHHHHHHHHHHHHHHHHHC
GVLWVLRINTKKGRDQRMSADELRAIVLESSSFMPTKHRSILLNLFDLENITVDDVMVPR
CEEEEEEEECCCCCCCCCCHHHHHHHHCCCCCCCCCHHHHHHHHHHHCCCCCHHHHHHCH
RQIESLNFYAPLDDILHQLETCYHNRLVVYEGDIDKVLGVLHVRKTLTGLHNQDFDRETL
HHHHCCCCCCCHHHHHHHHHHHHCCCEEEEECCHHHHHHHHHHHHHHHHCCCCCCCHHHH
RALLAEPYYVPSGTPVVQQLQFFQETRQRTALVVNEYGELEGLVTPEDIIEELIGEFTTS
HHHHCCCCCCCCCCHHHHHHHHHHHHHHHHEEHEECCCCCCCCCCHHHHHHHHHHHHHHC
MPRSERAGGWDENGECIVSASMPLRELNRWLHLKLPTDGPKTLNGLVLEILEEIPEDDVC
CCCCCCCCCCCCCCCEEEECCCCHHHCCCEEEEEECCCCCHHHHHHHHHHHHHCCCCCHH
LKIGDVMLEVMRSDDQAVRTVKLFKPRGTRTGRTATR
HHHHHHHHHHHHCCCHHHHHHHEECCCCCCCCCCCCC
>Mature Secondary Structure
MYRARHIAVAGLCYISPIPVLHCPFQRVDQIPLWAQIGAVFLLLLCSSFFSISETAMMAL
CCCCHHHHHHHHHHHCCCCCEECCHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHH
NRHRLKHLAGQGALGAKTTQGLLTRTDLLLSVILIGNNLFNTIIPVLTTSLALHTFGRNN
HHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHCCCCC
LALSIATGVVAFLIIVFAEIAPKIVGATFPERIALPASLVIAPLMRVFKPVVWFVNALAN
EEEEHHHHHHHHHHHHHHHHHHHHHCCCCCHHHCCCHHHHHHHHHHHHHHHHHHHHHHHC
GVLWVLRINTKKGRDQRMSADELRAIVLESSSFMPTKHRSILLNLFDLENITVDDVMVPR
CEEEEEEEECCCCCCCCCCHHHHHHHHCCCCCCCCCHHHHHHHHHHHCCCCCHHHHHHCH
RQIESLNFYAPLDDILHQLETCYHNRLVVYEGDIDKVLGVLHVRKTLTGLHNQDFDRETL
HHHHCCCCCCCHHHHHHHHHHHHCCCEEEEECCHHHHHHHHHHHHHHHHCCCCCCCHHHH
RALLAEPYYVPSGTPVVQQLQFFQETRQRTALVVNEYGELEGLVTPEDIIEELIGEFTTS
HHHHCCCCCCCCCCHHHHHHHHHHHHHHHHEEHEECCCCCCCCCCHHHHHHHHHHHHHHC
MPRSERAGGWDENGECIVSASMPLRELNRWLHLKLPTDGPKTLNGLVLEILEEIPEDDVC
CCCCCCCCCCCCCCCEEEECCCCHHHCCCEEEEEECCCCCHHHHHHHHHHHHHCCCCCHH
LKIGDVMLEVMRSDDQAVRTVKLFKPRGTRTGRTATR
HHHHHHHHHHHHCCCHHHHHHHEECCCCCCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 9205837; 9278503; 3045760 [H]