Definition Burkholderia glumae BGR1 chromosome chromosome 2, complete sequence.
Accession NC_012721
Length 2,827,333

Click here to switch to the map view.

The map label for this gene is yejA [C]

Identifier: 238025549

GI number: 238025549

Start: 2785251

End: 2787176

Strand: Reverse

Name: yejA [C]

Synonym: bglu_2g22460

Alternate gene names: 238025549

Gene position: 2787176-2785251 (Counterclockwise)

Preceding gene: 238025550

Following gene: 238025548

Centisome position: 98.58

GC content: 68.28

Gene sequence:

>1926_bases
ATGAATTCTGTCTCGATGCGCCGGCCACGGGCCGCGGGTCACGCCCTGGCCGCCCGCCTCGCGCGCGTGGCCGCCTTCGC
GTGCGTCGCGGCGGCGGCCTGCTTCATGCAGCCGGGCGCCGCGCTTGCCGTGCCGGCGATCGCGCAGTACGACGCGCCGA
AGTACCCGCCGAACTTCACGCATTTCGACTACGCGGACCCGGACGCGCCCGCCGACGGCACGCTCACGTTCAACAACTAC
AACCAGCTGCAGAGCTACGACTCGCTGAACCCGTTCCTGGTGCGCGGCGCGCCGGCGCCGGACATCCAGAACCTGATGTT
CGACACGCTGATGCAGCGCAGCTGGGACGAGCTGGCCTCCGAATATCCGCTGATCGCCGACGACGTCGAGATCGCGCCGG
ACCGCAGCTCGGCCACCTTCCACATCAATCCGGCCGCGCGTTTCTCGAACGGCGACCCGATCACGGCCGCCGACGTCAAG
TATTCGTTCGACACGCTGGCGAGCCCGCAGGCCTCGCCGATCGTCAACGCGCAGTTCGAGGTGATTCGCCGCGCCACGGT
GGTGGACCGCCTCACGGTGCGTTTCGATTTCAAGCGGCCCGAGCGCTCGGCGCCGCTGATCGCGGGCGATCTGCCGGTGT
TCTCGCCGAAGTGGGGGCAGCGCGCCGACGGCACGCGCCCGCCGTTCGACCAGATCGTGGAGGTGCCGCCGATCGCGAGC
GGCGCCTACCTGATCGCCGAGCGCGCCAACGACAAGCAGATCGTCTACGAGCGCAATCCGCAGTACTGGGCCGCCAACCT
GCCGACGCGGCGCGGCATGTTCCGCTTCCAGCGCATCACGTTCAAGCTCTATGTCGACCTCTACACCATGCTCGAGGCGT
TCAAGGCCGGCGACATCGACATGCGCATGGAATACAGCTCGTCGCAATGGGCGCGCCGCTACGTGGGCAAGAATTTCGAC
AACGGGCTGCTGAAACAGGGGCTGTTTCCCGACGGCCCGCCGCAGATGCAGGGCTTCCTGATCAACCTGCGCCGGCCGAT
GTTCCAGGACGTGCGGGTGCGCCACGCGCTGGCGCTGGCGTTCGACTACGACTGGATGAACCGGATGATGTTCTACGGCC
AGTACCGGCGGACCAACAGCTTCTGGGAGGCGAGCCCGTTCGGCGCCACCGGCATGCCCAGCGAGAAGGAGCTGGCGCTG
CTCGAGCCGTTCCGCAAGTCGCTGCCGCCCGAGGTGTTCGGGCCGATGGTGAAGCAGCCCAGCACGCTGCCGCCGAACTC
GCTGCGCGGCAACCTCAAGCAGGCGCGGGCGCTGCTGGAGGCGGCCGGCTGGCACTATCGCGACGGCGCGCTGCGCGACG
CCAACGGCACCCCGATGACGATCGAGATCATCGACGACGAGCCCGGCATGGACCGCCTGATCCTGCCGTACACGCAGGCG
CTCGCGCTGCTCGGCATCCACGCCTGGCTGCACGAGATCGACAGCGCGCTGTATCAGAAGCGGCTCGACAACTTCCAGTA
CGACATGACCACCTACATCTACGCGCCGGTCACGATCCCCGGCGCGGAGCTGACGCGCCGCTTCGGCAGCGCGGCCGCCG
ACGAGCCCGGCTCGGAAAACTATCCGGGCCTGAAGTCGAAGGCGGTGGACGCGTTGATCCGCGACGTGCTCGCGGCCGAC
ACGCTCGACCAGCTGGAGACGGCCACCCGCGCGCTCGACCGCGTGCTGATCAACCTCTACATCCTGGTGCCGCAGTACTA
CCTGCCCAACGCGCGGATCGCCTACAAGAGCACCTACGGCCATCCGAAGGTGATTCCCGCGTCGTTCAACTACGAGGACT
GGATGATCGACTACTGGTACCGCAAGCGCCCCGCCGCGGGCGCCGCGCACGCGGCCGGCGCCTCGGGTGCCGCCGGCAAG
GAGTGA

Upstream 100 bases:

>100_bases
CCCCCGCTGCTGCGCGGGCCGGCGCGGCGGCCCGCCTCCCTCAACCCTTGACGACGGCATGCCGGCCGCCCGGCGGCATG
CCCTCCACCGCAGGATGACG

Downstream 100 bases:

>100_bases
CACGATGCTCGCCTACATACTCAGACGTCTGCTGCTGATGATCCCGACCATCATCGGCGTGGTGACGATCACCTTCGTGG
TCACGCAGTTCGTGCCGGGC

Product: family 5 extracellular solute-binding protein

Products: ADP; phosphate; oligopeptides [Cytoplasm] [C]

Alternate protein names: NA

Number of amino acids: Translated: 641; Mature: 641

Protein sequence:

>641_residues
MNSVSMRRPRAAGHALAARLARVAAFACVAAAACFMQPGAALAVPAIAQYDAPKYPPNFTHFDYADPDAPADGTLTFNNY
NQLQSYDSLNPFLVRGAPAPDIQNLMFDTLMQRSWDELASEYPLIADDVEIAPDRSSATFHINPAARFSNGDPITAADVK
YSFDTLASPQASPIVNAQFEVIRRATVVDRLTVRFDFKRPERSAPLIAGDLPVFSPKWGQRADGTRPPFDQIVEVPPIAS
GAYLIAERANDKQIVYERNPQYWAANLPTRRGMFRFQRITFKLYVDLYTMLEAFKAGDIDMRMEYSSSQWARRYVGKNFD
NGLLKQGLFPDGPPQMQGFLINLRRPMFQDVRVRHALALAFDYDWMNRMMFYGQYRRTNSFWEASPFGATGMPSEKELAL
LEPFRKSLPPEVFGPMVKQPSTLPPNSLRGNLKQARALLEAAGWHYRDGALRDANGTPMTIEIIDDEPGMDRLILPYTQA
LALLGIHAWLHEIDSALYQKRLDNFQYDMTTYIYAPVTIPGAELTRRFGSAAADEPGSENYPGLKSKAVDALIRDVLAAD
TLDQLETATRALDRVLINLYILVPQYYLPNARIAYKSTYGHPKVIPASFNYEDWMIDYWYRKRPAAGAAHAAGASGAAGK
E

Sequences:

>Translated_641_residues
MNSVSMRRPRAAGHALAARLARVAAFACVAAAACFMQPGAALAVPAIAQYDAPKYPPNFTHFDYADPDAPADGTLTFNNY
NQLQSYDSLNPFLVRGAPAPDIQNLMFDTLMQRSWDELASEYPLIADDVEIAPDRSSATFHINPAARFSNGDPITAADVK
YSFDTLASPQASPIVNAQFEVIRRATVVDRLTVRFDFKRPERSAPLIAGDLPVFSPKWGQRADGTRPPFDQIVEVPPIAS
GAYLIAERANDKQIVYERNPQYWAANLPTRRGMFRFQRITFKLYVDLYTMLEAFKAGDIDMRMEYSSSQWARRYVGKNFD
NGLLKQGLFPDGPPQMQGFLINLRRPMFQDVRVRHALALAFDYDWMNRMMFYGQYRRTNSFWEASPFGATGMPSEKELAL
LEPFRKSLPPEVFGPMVKQPSTLPPNSLRGNLKQARALLEAAGWHYRDGALRDANGTPMTIEIIDDEPGMDRLILPYTQA
LALLGIHAWLHEIDSALYQKRLDNFQYDMTTYIYAPVTIPGAELTRRFGSAAADEPGSENYPGLKSKAVDALIRDVLAAD
TLDQLETATRALDRVLINLYILVPQYYLPNARIAYKSTYGHPKVIPASFNYEDWMIDYWYRKRPAAGAAHAAGASGAAGK
E
>Mature_641_residues
MNSVSMRRPRAAGHALAARLARVAAFACVAAAACFMQPGAALAVPAIAQYDAPKYPPNFTHFDYADPDAPADGTLTFNNY
NQLQSYDSLNPFLVRGAPAPDIQNLMFDTLMQRSWDELASEYPLIADDVEIAPDRSSATFHINPAARFSNGDPITAADVK
YSFDTLASPQASPIVNAQFEVIRRATVVDRLTVRFDFKRPERSAPLIAGDLPVFSPKWGQRADGTRPPFDQIVEVPPIAS
GAYLIAERANDKQIVYERNPQYWAANLPTRRGMFRFQRITFKLYVDLYTMLEAFKAGDIDMRMEYSSSQWARRYVGKNFD
NGLLKQGLFPDGPPQMQGFLINLRRPMFQDVRVRHALALAFDYDWMNRMMFYGQYRRTNSFWEASPFGATGMPSEKELAL
LEPFRKSLPPEVFGPMVKQPSTLPPNSLRGNLKQARALLEAAGWHYRDGALRDANGTPMTIEIIDDEPGMDRLILPYTQA
LALLGIHAWLHEIDSALYQKRLDNFQYDMTTYIYAPVTIPGAELTRRFGSAAADEPGSENYPGLKSKAVDALIRDVLAAD
TLDQLETATRALDRVLINLYILVPQYYLPNARIAYKSTYGHPKVIPASFNYEDWMIDYWYRKRPAAGAAHAAGASGAAGK
E

Specific function: Unknown

COG id: COG4166

COG function: function code E; ABC-type oligopeptide transport system, periplasmic component

Gene ontology:

Cell location: Periplasm (Potential) [H]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the bacterial solute-binding protein 5 family [H]

Homologues:

Organism=Escherichia coli, GI87082063, Length=579, Percent_Identity=34.8877374784111, Blast_Score=330, Evalue=1e-91,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR000914 [H]

Pfam domain/function: PF00496 SBP_bac_5 [H]

EC number: NA

Molecular weight: Translated: 71809; Mature: 71809

Theoretical pI: Translated: 7.03; Mature: 7.03

Prosite motif: PS00013 PROKAR_LIPOPROTEIN

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.3 %Cys     (Translated Protein)
3.1 %Met     (Translated Protein)
3.4 %Cys+Met (Translated Protein)
0.3 %Cys     (Mature Protein)
3.1 %Met     (Mature Protein)
3.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MNSVSMRRPRAAGHALAARLARVAAFACVAAAACFMQPGAALAVPAIAQYDAPKYPPNFT
CCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCEECCHHHHCCCCCCCCCCC
HFDYADPDAPADGTLTFNNYNQLQSYDSLNPFLVRGAPAPDIQNLMFDTLMQRSWDELAS
CCCCCCCCCCCCCEEEECCCHHHHHCCCCCCEEEECCCCCHHHHHHHHHHHHHHHHHHHH
EYPLIADDVEIAPDRSSATFHINPAARFSNGDPITAADVKYSFDTLASPQASPIVNAQFE
CCCEEECCCEECCCCCCCEEEECCHHCCCCCCCCEEEECEECHHHHCCCCCCCCCCHHHH
VIRRATVVDRLTVRFDFKRPERSAPLIAGDLPVFSPKWGQRADGTRPPFDQIVEVPPIAS
HHHHHHHHHEEEEEEECCCCCCCCCEEECCCCCCCCCCCCCCCCCCCCHHHHHCCCCCCC
GAYLIAERANDKQIVYERNPQYWAANLPTRRGMFRFQRITFKLYVDLYTMLEAFKAGDID
CCEEEEECCCCCEEEEECCCCEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCE
MRMEYSSSQWARRYVGKNFDNGLLKQGLFPDGPPQMQGFLINLRRPMFQDVRVRHALALA
EEEECCHHHHHHHHHCCCCCCHHHHCCCCCCCCHHHHHHHHHHHCHHHHHHHHHHHHHHE
FDYDWMNRMMFYGQYRRTNSFWEASPFGATGMPSEKELALLEPFRKSLPPEVFGPMVKQP
ECHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHCCCHHHHHHHHCCC
STLPPNSLRGNLKQARALLEAAGWHYRDGALRDANGTPMTIEIIDDEPGMDRLILPYTQA
CCCCCHHHHCCHHHHHHHHHHCCCEECCCCEECCCCCEEEEEEECCCCCCCCEEHHHHHH
LALLGIHAWLHEIDSALYQKRLDNFQYDMTTYIYAPVTIPGAELTRRFGSAAADEPGSEN
HHHHHHHHHHHHHHHHHHHHHHCCCCEEEEEEEEEEEECCHHHHHHHHCCCCCCCCCCCC
YPGLKSKAVDALIRDVLAADTLDQLETATRALDRVLINLYILVPQYYLPNARIAYKSTYG
CCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHEECHHCCCCCEEEEEECCC
HPKVIPASFNYEDWMIDYWYRKRPAAGAAHAAGASGAAGKE
CCEEEECCCCCCCCEEEHHHHCCCCCCCHHCCCCCCCCCCC
>Mature Secondary Structure
MNSVSMRRPRAAGHALAARLARVAAFACVAAAACFMQPGAALAVPAIAQYDAPKYPPNFT
CCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCEECCHHHHCCCCCCCCCCC
HFDYADPDAPADGTLTFNNYNQLQSYDSLNPFLVRGAPAPDIQNLMFDTLMQRSWDELAS
CCCCCCCCCCCCCEEEECCCHHHHHCCCCCCEEEECCCCCHHHHHHHHHHHHHHHHHHHH
EYPLIADDVEIAPDRSSATFHINPAARFSNGDPITAADVKYSFDTLASPQASPIVNAQFE
CCCEEECCCEECCCCCCCEEEECCHHCCCCCCCCEEEECEECHHHHCCCCCCCCCCHHHH
VIRRATVVDRLTVRFDFKRPERSAPLIAGDLPVFSPKWGQRADGTRPPFDQIVEVPPIAS
HHHHHHHHHEEEEEEECCCCCCCCCEEECCCCCCCCCCCCCCCCCCCCHHHHHCCCCCCC
GAYLIAERANDKQIVYERNPQYWAANLPTRRGMFRFQRITFKLYVDLYTMLEAFKAGDID
CCEEEEECCCCCEEEEECCCCEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCE
MRMEYSSSQWARRYVGKNFDNGLLKQGLFPDGPPQMQGFLINLRRPMFQDVRVRHALALA
EEEECCHHHHHHHHHCCCCCCHHHHCCCCCCCCHHHHHHHHHHHCHHHHHHHHHHHHHHE
FDYDWMNRMMFYGQYRRTNSFWEASPFGATGMPSEKELALLEPFRKSLPPEVFGPMVKQP
ECHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHCCCHHHHHHHHCCC
STLPPNSLRGNLKQARALLEAAGWHYRDGALRDANGTPMTIEIIDDEPGMDRLILPYTQA
CCCCCHHHHCCHHHHHHHHHHCCCEECCCCEECCCCCEEEEEEECCCCCCCCEEHHHHHH
LALLGIHAWLHEIDSALYQKRLDNFQYDMTTYIYAPVTIPGAELTRRFGSAAADEPGSEN
HHHHHHHHHHHHHHHHHHHHHHCCCCEEEEEEEEEEEECCHHHHHHHHCCCCCCCCCCCC
YPGLKSKAVDALIRDVLAADTLDQLETATRALDRVLINLYILVPQYYLPNARIAYKSTYG
CCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHEECHHCCCCCEEEEEECCC
HPKVIPASFNYEDWMIDYWYRKRPAAGAAHAAGASGAAGKE
CCEEEECCCCCCCCEEEHHHHCCCCCCCHHCCCCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: ATP; oligopeptides [Periplasm]; H2O [C]

Specific reaction: ATP + oligopeptides [Periplasm] + H2O = ADP + phosphate + oligopeptides [Cytoplasm] [C]

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA