Definition Burkholderia phymatum STM815 chromosome chromosome 1, complete sequence.
Accession NC_010622
Length 3,479,187

Click here to switch to the map view.

The map label for this gene is epsB [H]

Identifier: 186477221

GI number: 186477221

Start: 2775691

End: 2777916

Strand: Reverse

Name: epsB [H]

Synonym: Bphy_2472

Alternate gene names: 186477221

Gene position: 2777916-2775691 (Counterclockwise)

Preceding gene: 186477222

Following gene: 186477220

Centisome position: 79.84

GC content: 64.51

Gene sequence:

>2226_bases
ATGGCTATCAACTTTGACAATCGCTATACGGACGTCAGTTCGGACGAGATGCATCTGACGGATTATCTGCAGGCCATCGT
CGCGAACTGGCGCTCGATTCTGCTGATTACGCTGGCCGTCACGGCACTGGGGACCGCCTACGCCTTCCTTGCGACGCCCG
TCTACCGTGCGGACGTTCTGTTCCATGTGGTCGACAAGTCCGAAAACAACAACAAGCAGGACGGCCTCCAGCCCCTCACG
GGGATGTTCGACACGAAGCCCTCCACGGCGGCCGAAATCGAGCTGATGAAGTCGCGGCTCGTGACGGAAGAGACCGTCAA
GCAGCTGCACCTCGATATCGCCGCGCGGCCGCATACGCTGCCTTTCGTCGGCGGGCTGCTGGCGCCGCTGATGAGCGGCA
AGTGGGGCATCAAGCTGCCGCCGTCGCTGCAGCTGCCGAGCTACGCGTGGGGCAACGAGAGCATCAAGGTGTCGCGCTTC
GACACCGCCAAGGACATGTACGACAAGGACTTCACGCTGATTGCCGGCCAGAACGGCGACTTCGTGCTGAACAACCCGGA
CGGGGTCGCGATTCTCGAAGGCAAGGTCGGCGAAAACGTCGTGCGCGAAACGCCGGCTGGCCCGATCGCGCTGCGTGTCG
ACGAGATCGTCGGCGCGCCGGGCACGCGCTACGAGCTGACGCGTGCGTCAACGCTGACGACCGTCGAGCGTTTGCAAAAG
GCGATGGATATCGGCGAGTCGACGCTGCAGTCGGGTGTGATCCGCGCGAGCCTCGAGGGCCAGAATCCGAAGCTCACGGC
CGACATCATGAACAGCATGGCGCGCGAGTTCATCCGCCAGGATGTCGAAAGCCGTTCGTCGGAGGCCGAGCACATGCTGG
CGTTCCTCGACCAGCAGCTGCCGCAGCTGCGCAAGGAACTGGACGCCGCCGAGCAGCGCTACAACACGTTCCGCAACCAG
CACGGCACCGTCGATCTGAGCGAAGAAAGCCGGCTGCTGCTGCAGCAGATCGTCGACAACAAGACCAAGCTCGTCGACCT
GCAGACGCAGCGCGCGGAGATGTCACAGCGCTTCACCGCCAATCACCCCGCCGTGGCCGCGCTCGACGCGCAGATCGCTT
CGCTGCAGGGCAATCTGTCGAAGATGGGCAAGAGTGTGCAGACGCTGCCCGACACCGAACAGACGGCGCTGCGTCTGTTG
CGCGACGTGCACGTCGACACCGAGCTCTACACGAACCTGCTCAACAGCGCGCAGCAGCTGCGCATCGCCAAGGCAGGCCA
GGTGGGCGACGTGCGGATCGTCGACTTCGCCGAAGCCGCCGACGACCCCGTGCGTCCGAAGCGCCTGATGGTGATCCTGA
TCAGCTTCGGCTCGGGTCTGTTCATCGGCATCGTGTTCGCCTTCGTGCGCAAGACGCTGTACGGCGGTGTCGAACGTCCG
GACGAGCTGGAATCCGCACTCGGCGTGCCCGTCTTCGCCGTGGTGCCGCGCAGCGAGCAGCAGATCCGCCTGCAGCAGGA
CGTGATGATGCGCCGGCGCGGCCTGCACGTGCTCGCCGAACAGGCGCCGCAGGACATCGCGGTGGAAGGCGTGCGCAACC
TGCGCACCTCGCTGCAGCTGACGGTCGACGACAAGCAGAACAACGTCGTGATGCTGACGGGCTCGCGCCCGGATGCCGGC
AAGTCGTTCCTGTCGGTGAATCTGTCGGCGCTCGTCGCGTCGACGGCCAAGCGCACACTGGTGATCGACGGCGACATGCG
GCGGGGCGACGTGCACTCGCACTTCGGCCTGCAGCACCAGCCGGGTCTTTCCGACGTGCTGCGCGGCGGCGATCTGCAGT
CGTCGATCCAGCGCGAAGTGCTGCCCGGCCTCGACGTGCTGACCAAGGGCTCGCTGCCCTCGCATCCTTCCGAACTGCTG
ATGAGCAAGCGCTTCGAAACGATGCTCGAGGAACTCAAGAACCAGTACGACCTGATCATCATCGATACGCCGCCCGTGCT
CGCCGTCACCGATTCGACCGTGATCGGCAAGCACGTGGGGACGACGTTGCTCGTGATTCGTCACGGCCGCCATCCGGTGA
GCGAACTCGCGGAAACTGCGAAGCGCTTGCGTAACGGCGGCGTGAATTTGCAGGGGGTGTTGTTGACCGACGTACCGCAG
GCGGGCGCGTTCATCGGCTCGGGTTATCGAGGCGGCTACTACGGCTACGAGAGTATCGCAGGCTGA

Upstream 100 bases:

>100_bases
CGAAGTAGTAAGCGGCGGGGCATGCGTTGCGCGCTTTGCATCAGCGGGGATAAGGGCGCGCAACGCTCTCAAGAGTGTTG
GTCTTTGATGGATCACGCAA

Downstream 100 bases:

>100_bases
CAGCAGCGCATGTCCGGCAGGGCGGCAAGGGAGCACCCGCGGACATCTACACGAACTGGTGCAAGGGCTGGGGGCCGCGC
ACAGGCCACAACCCGGCCGA

Product: exopolysaccharide transport protein family

Products: ADP; protein tyrosine phosphate [C]

Alternate protein names: EPS I polysaccharide export protein epsB [H]

Number of amino acids: Translated: 741; Mature: 740

Protein sequence:

>741_residues
MAINFDNRYTDVSSDEMHLTDYLQAIVANWRSILLITLAVTALGTAYAFLATPVYRADVLFHVVDKSENNNKQDGLQPLT
GMFDTKPSTAAEIELMKSRLVTEETVKQLHLDIAARPHTLPFVGGLLAPLMSGKWGIKLPPSLQLPSYAWGNESIKVSRF
DTAKDMYDKDFTLIAGQNGDFVLNNPDGVAILEGKVGENVVRETPAGPIALRVDEIVGAPGTRYELTRASTLTTVERLQK
AMDIGESTLQSGVIRASLEGQNPKLTADIMNSMAREFIRQDVESRSSEAEHMLAFLDQQLPQLRKELDAAEQRYNTFRNQ
HGTVDLSEESRLLLQQIVDNKTKLVDLQTQRAEMSQRFTANHPAVAALDAQIASLQGNLSKMGKSVQTLPDTEQTALRLL
RDVHVDTELYTNLLNSAQQLRIAKAGQVGDVRIVDFAEAADDPVRPKRLMVILISFGSGLFIGIVFAFVRKTLYGGVERP
DELESALGVPVFAVVPRSEQQIRLQQDVMMRRRGLHVLAEQAPQDIAVEGVRNLRTSLQLTVDDKQNNVVMLTGSRPDAG
KSFLSVNLSALVASTAKRTLVIDGDMRRGDVHSHFGLQHQPGLSDVLRGGDLQSSIQREVLPGLDVLTKGSLPSHPSELL
MSKRFETMLEELKNQYDLIIIDTPPVLAVTDSTVIGKHVGTTLLVIRHGRHPVSELAETAKRLRNGGVNLQGVLLTDVPQ
AGAFIGSGYRGGYYGYESIAG

Sequences:

>Translated_741_residues
MAINFDNRYTDVSSDEMHLTDYLQAIVANWRSILLITLAVTALGTAYAFLATPVYRADVLFHVVDKSENNNKQDGLQPLT
GMFDTKPSTAAEIELMKSRLVTEETVKQLHLDIAARPHTLPFVGGLLAPLMSGKWGIKLPPSLQLPSYAWGNESIKVSRF
DTAKDMYDKDFTLIAGQNGDFVLNNPDGVAILEGKVGENVVRETPAGPIALRVDEIVGAPGTRYELTRASTLTTVERLQK
AMDIGESTLQSGVIRASLEGQNPKLTADIMNSMAREFIRQDVESRSSEAEHMLAFLDQQLPQLRKELDAAEQRYNTFRNQ
HGTVDLSEESRLLLQQIVDNKTKLVDLQTQRAEMSQRFTANHPAVAALDAQIASLQGNLSKMGKSVQTLPDTEQTALRLL
RDVHVDTELYTNLLNSAQQLRIAKAGQVGDVRIVDFAEAADDPVRPKRLMVILISFGSGLFIGIVFAFVRKTLYGGVERP
DELESALGVPVFAVVPRSEQQIRLQQDVMMRRRGLHVLAEQAPQDIAVEGVRNLRTSLQLTVDDKQNNVVMLTGSRPDAG
KSFLSVNLSALVASTAKRTLVIDGDMRRGDVHSHFGLQHQPGLSDVLRGGDLQSSIQREVLPGLDVLTKGSLPSHPSELL
MSKRFETMLEELKNQYDLIIIDTPPVLAVTDSTVIGKHVGTTLLVIRHGRHPVSELAETAKRLRNGGVNLQGVLLTDVPQ
AGAFIGSGYRGGYYGYESIAG
>Mature_740_residues
AINFDNRYTDVSSDEMHLTDYLQAIVANWRSILLITLAVTALGTAYAFLATPVYRADVLFHVVDKSENNNKQDGLQPLTG
MFDTKPSTAAEIELMKSRLVTEETVKQLHLDIAARPHTLPFVGGLLAPLMSGKWGIKLPPSLQLPSYAWGNESIKVSRFD
TAKDMYDKDFTLIAGQNGDFVLNNPDGVAILEGKVGENVVRETPAGPIALRVDEIVGAPGTRYELTRASTLTTVERLQKA
MDIGESTLQSGVIRASLEGQNPKLTADIMNSMAREFIRQDVESRSSEAEHMLAFLDQQLPQLRKELDAAEQRYNTFRNQH
GTVDLSEESRLLLQQIVDNKTKLVDLQTQRAEMSQRFTANHPAVAALDAQIASLQGNLSKMGKSVQTLPDTEQTALRLLR
DVHVDTELYTNLLNSAQQLRIAKAGQVGDVRIVDFAEAADDPVRPKRLMVILISFGSGLFIGIVFAFVRKTLYGGVERPD
ELESALGVPVFAVVPRSEQQIRLQQDVMMRRRGLHVLAEQAPQDIAVEGVRNLRTSLQLTVDDKQNNVVMLTGSRPDAGK
SFLSVNLSALVASTAKRTLVIDGDMRRGDVHSHFGLQHQPGLSDVLRGGDLQSSIQREVLPGLDVLTKGSLPSHPSELLM
SKRFETMLEELKNQYDLIIIDTPPVLAVTDSTVIGKHVGTTLLVIRHGRHPVSELAETAKRLRNGGVNLQGVLLTDVPQA
GAFIGSGYRGGYYGYESIAG

Specific function: Probably involved in polymerization and/or export of exopolysaccharide EPS I which functions as a virulence factor. May be involved in an ATP-dependent process in the pathway for EPS I production, possibly export of the trimeric repeat units across the in

COG id: COG3206

COG function: function code M; Uncharacterized protein involved in exopolysaccharide biosynthesis

Gene ontology:

Cell location: Cell inner membrane; Multi-pass membrane protein [H]

Metaboloic importance: Non Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the etk/wzc family [H]

Homologues:

Organism=Escherichia coli, GI87082032, Length=733, Percent_Identity=35.6070941336971, Blast_Score=440, Evalue=1e-124,
Organism=Escherichia coli, GI1787216, Length=725, Percent_Identity=34.2068965517241, Blast_Score=425, Evalue=1e-120,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR002586
- InterPro:   IPR005702
- InterPro:   IPR005700
- InterPro:   IPR003856 [H]

Pfam domain/function: PF01656 CbiA; PF02706 Wzz [H]

EC number: 2.7.1.112 [C]

Molecular weight: Translated: 81390; Mature: 81259

Theoretical pI: Translated: 6.12; Mature: 6.12

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.0 %Cys     (Translated Protein)
2.6 %Met     (Translated Protein)
2.6 %Cys+Met (Translated Protein)
0.0 %Cys     (Mature Protein)
2.4 %Met     (Mature Protein)
2.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MAINFDNRYTDVSSDEMHLTDYLQAIVANWRSILLITLAVTALGTAYAFLATPVYRADVL
CEECCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCHHHHHHHH
FHVVDKSENNNKQDGLQPLTGMFDTKPSTAAEIELMKSRLVTEETVKQLHLDIAARPHTL
EEEECCCCCCCCHHCCCHHHCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCC
PFVGGLLAPLMSGKWGIKLPPSLQLPSYAWGNESIKVSRFDTAKDMYDKDFTLIAGQNGD
HHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCEEEEECCCHHHHCCCCEEEEECCCCC
FVLNNPDGVAILEGKVGENVVRETPAGPIALRVDEIVGAPGTRYELTRASTLTTVERLQK
EEEECCCCEEEEECCCCCHHHHHCCCCCEEEEEHHHHCCCCCCEEEHHHHHHHHHHHHHH
AMDIGESTLQSGVIRASLEGQNPKLTADIMNSMAREFIRQDVESRSSEAEHMLAFLDQQL
HHHCCHHHHHCCCEEEEECCCCCEEHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
PQLRKELDAAEQRYNTFRNQHGTVDLSEESRLLLQQIVDNKTKLVDLQTQRAEMSQRFTA
HHHHHHHHHHHHHHHHHHCCCCEEEECHHHHHHHHHHHCCCCEEEEEHHHHHHHHHHHCC
NHPAVAALDAQIASLQGNLSKMGKSVQTLPDTEQTALRLLRDVHVDTELYTNLLNSAQQL
CCCCEEHHHHHHHHHCCCHHHHCCHHHCCCCCHHHHHHHHHHHCCCHHHHHHHHHHHHHH
RIAKAGQVGDVRIVDFAEAADDPVRPKRLMVILISFGSGLFIGIVFAFVRKTLYGGVERP
HHHCCCCCCCEEEEEEHHCCCCCCCCCEEEEEEEECCCHHHHHHHHHHHHHHHHCCCCCH
DELESALGVPVFAVVPRSEQQIRLQQDVMMRRRGLHVLAEQAPQDIAVEGVRNLRTSLQL
HHHHHHHCCCEEEEECCCHHHHHHHHHHHHHHHCHHHHHHHCCHHHHHHHHHHHHCEEEE
TVDDKQNNVVMLTGSRPDAGKSFLSVNLSALVASTAKRTLVIDGDMRRGDVHSHFGLQHQ
EEECCCCCEEEEECCCCCCCCHHHHHHHHHHHHHHCCCEEEEECCCCCCCCHHHCCCCCC
PGLSDVLRGGDLQSSIQREVLPGLDVLTKGSLPSHPSELLMSKRFETMLEELKNQYDLII
CCHHHHHCCCCHHHHHHHHHCCCCCCEECCCCCCCHHHHHHHHHHHHHHHHHCCCCCEEE
IDTPPVLAVTDSTVIGKHVGTTLLVIRHGRHPVSELAETAKRLRNGGVNLQGVLLTDVPQ
ECCCCEEEEECCHHHHHHHCCEEEEEECCCCCHHHHHHHHHHHHCCCCCEEEEEEECCCC
AGAFIGSGYRGGYYGYESIAG
CCCEECCCCCCCCCCHHHCCC
>Mature Secondary Structure 
AINFDNRYTDVSSDEMHLTDYLQAIVANWRSILLITLAVTALGTAYAFLATPVYRADVL
EECCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCHHHHHHHH
FHVVDKSENNNKQDGLQPLTGMFDTKPSTAAEIELMKSRLVTEETVKQLHLDIAARPHTL
EEEECCCCCCCCHHCCCHHHCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCC
PFVGGLLAPLMSGKWGIKLPPSLQLPSYAWGNESIKVSRFDTAKDMYDKDFTLIAGQNGD
HHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCEEEEECCCHHHHCCCCEEEEECCCCC
FVLNNPDGVAILEGKVGENVVRETPAGPIALRVDEIVGAPGTRYELTRASTLTTVERLQK
EEEECCCCEEEEECCCCCHHHHHCCCCCEEEEEHHHHCCCCCCEEEHHHHHHHHHHHHHH
AMDIGESTLQSGVIRASLEGQNPKLTADIMNSMAREFIRQDVESRSSEAEHMLAFLDQQL
HHHCCHHHHHCCCEEEEECCCCCEEHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
PQLRKELDAAEQRYNTFRNQHGTVDLSEESRLLLQQIVDNKTKLVDLQTQRAEMSQRFTA
HHHHHHHHHHHHHHHHHHCCCCEEEECHHHHHHHHHHHCCCCEEEEEHHHHHHHHHHHCC
NHPAVAALDAQIASLQGNLSKMGKSVQTLPDTEQTALRLLRDVHVDTELYTNLLNSAQQL
CCCCEEHHHHHHHHHCCCHHHHCCHHHCCCCCHHHHHHHHHHHCCCHHHHHHHHHHHHHH
RIAKAGQVGDVRIVDFAEAADDPVRPKRLMVILISFGSGLFIGIVFAFVRKTLYGGVERP
HHHCCCCCCCEEEEEEHHCCCCCCCCCEEEEEEEECCCHHHHHHHHHHHHHHHHCCCCCH
DELESALGVPVFAVVPRSEQQIRLQQDVMMRRRGLHVLAEQAPQDIAVEGVRNLRTSLQL
HHHHHHHCCCEEEEECCCHHHHHHHHHHHHHHHCHHHHHHHCCHHHHHHHHHHHHCEEEE
TVDDKQNNVVMLTGSRPDAGKSFLSVNLSALVASTAKRTLVIDGDMRRGDVHSHFGLQHQ
EEECCCCCEEEEECCCCCCCCHHHHHHHHHHHHHHCCCEEEEECCCCCCCCHHHCCCCCC
PGLSDVLRGGDLQSSIQREVLPGLDVLTKGSLPSHPSELLMSKRFETMLEELKNQYDLII
CCHHHHHCCCCHHHHHHHHHCCCCCCEECCCCCCCHHHHHHHHHHHHHHHHHCCCCCEEE
IDTPPVLAVTDSTVIGKHVGTTLLVIRHGRHPVSELAETAKRLRNGGVNLQGVLLTDVPQ
ECCCCEEEEECCHHHHHHHCCEEEEEECCCCCHHHHHHHHHHHHCCCCCEEEEEEECCCC
AGAFIGSGYRGGYYGYESIAG
CCCEECCCCCCCCCCHHHCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: ATP; a protein tyrosine [C]

Specific reaction: ATP + a protein tyrosine = ADP + protein tyrosine phosphate [C]

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 11823852 [H]