Definition Parabacteroides distasonis ATCC 8503 chromosome, complete genome.
Accession NC_009615
Length 4,811,379

Click here to switch to the map view.

The map label for this gene is ylbK [H]

Identifier: 150009802

GI number: 150009802

Start: 3897930

End: 3900134

Strand: Direct

Name: ylbK [H]

Synonym: BDI_3218

Alternate gene names: 150009802

Gene position: 3897930-3900134 (Clockwise)

Preceding gene: 150009801

Following gene: 150009803

Centisome position: 81.01

GC content: 46.67

Gene sequence:

>2205_bases
ATGAGGAAGTTCCTTTTATTGTGGTTGGTTGGGTTGATGTTGGTGCCTTCTGTGATGGCTGAGCGGAAAAAGGTTGGCTT
GGTGCTGGGAGGCGGTGGGGCGAAAGGTGTCGCTCATATCGGGGTGTTGAAGGTATTGGAGGAGGCCGGCATCCCGATTG
ATTATATTGCCGGCACTAGTATGGGAGCTATCGTGGGGGGCTTATATTCCGTTGGATATAATGCTGCGGAAATCGATAGC
ATGGTGAGATTGCAGGACTGGAGTATGTTATTGAGCGACCGGGTGAAACGTAGTAGCCTTACTTTTCCGGAGAAAGAGAA
TTCCGAGCGTTATGTATTCTCACTCCCTTTTGGGCGGAGTAAAAAAGAGATAGCGATCCAAGGGATGATAAAAGGGCAAA
ATCTCCAGAACCTGTTCTCGAATCTAACGATCGGCTATCATGATTCCGTGGACTTCAATCAATTGAATATACCTTTCGCT
TGTGTGGCGTTGAATGTAGTGGACGGCCAAGAATATGTTTTCCATCATGGAAGTCTTCCGTTGGCTATGCGTGCCAGTAT
GGCGATTCCTGCCGTGTTCGCACCGGTACGTTTGGATAGCATGGTGTTGGTAGATGGTGGGATCAAGAATAACTATCCGG
CGGATGTCGCACGGGATATGGGGGCGGATATTATTATTGGCGTAGATCTGGGTACTAGCGACTTGAAACAGTTGGAGCGG
ATAAATACCCCTTGGGATATCGTAGGGCAGATCGTCGCCTTGCATGGTTATGAGAAATACGGACCGAATAAGGAACAAAC
CGATCTGTTGTTCCGCCCGAATACAGACCCTTATAATTCCGCTAGTTTTGGGGAGACGGCCTTGGATACCTTGATTGACC
GGGGTGAGCAAGTCGCCCGCAAGCAATGGGATGAGATTCTTGCCTTAAAGAAGAAGATTGGTTTATCCGATAGTTCGGAT
ATGCACCGAAAGAGATTAGTACATTCCTATCCGGTAGCCCCTACCGATACGTTTCATATCCGGCGTGTCTTGTTTGAAGG
TATAGATCCTCGTGATGAGAAATGGTTGACGCAAATCAGCGGCTTGAAAGAGAATAGCTTGCTTACCGTGAAGAAATTGC
AGGAAGCCATGTCTATCGTGATCGGTACAAACCTTTACTCGAATGTAAGCTATAAATTAGTCGGCGAGAGGCAGGAGGAT
TTGGTGCTTACGGTACAGGAAAAATCAAATAGCGCGATTAATGTGGGCCTGAATTTCAATAGCGAGGATATCGTCGCCCT
ATTGCTGAATGTGACTTTTGACAATCGGGCCCGTTACCATTCGAAGTTCTCCGTAACCGGGAGGATCGGGAAACGTATGT
ATGGGCGGGTGGACTATGCGATAGAGCGTAATCCATTGCGTAATATTAACCTGTCTTACATGTTCACGTACCATGACCTC
GACGTGTATAACAGGGGAGATAAGATCGTAAATACGACGTATCGCCATCATTTCGTGGAACTCGGGTATTCGGATATGAA
CTGGCTGAATTTCAAGTTGAAGCTAGGAGCCCGTTATGAGTATTTCGATTATAACTCATTCCTTTATACGGCGGAAAACC
AAAAGTATCAAGTAAAACCGGAAGGTTTTATCAGCTACTTCGCTCAAGCCCATCTGGAAACCTTGGACCGCCGTTACTTC
CCGAGTAAAGGCGTTTCTCTGCAAGCGGATTATTCCATTTATACGGATAACTTCGTGACCTATAAAGGACATACATTCTT
CTCCGCCTTGAAGCTCAGCTTCCTGTCGGTATTGCCGCTGACTTCCCATTTGAGCCTGTTACCTTCCATCGATGGGCGTG
TGTTGATCGGGAAAGATCCGGCTTATCCCTTTTTGAATGTGGTGGGAGGCGATATGCCGGCACGGTATCTTCCCCAGCAA
CTCCCTTTCGCTGGGATCAACCATATGGAGATATTCGATAATTCCGTGGCGATTGTCCGCTTAAACTTGCGTCAGCGTAT
CGGGCAACGGCATTATATCTCTTTGATCGCTAATTATGCGATCCATGAGAATAATTTCTTCGATCTCTTCAAGGGAGAAA
GCGTTTGGGGAGGTAGTATCGGTTATGCTTATAACAGTATAGTCGGTCCGATGAATACGAACTTCGGATTGTCGAACCGG
AATAATAACCTGCAATTTTATCTGAATCTGGGTTACAGTTTCTAA

Upstream 100 bases:

>100_bases
AGCGATAAACTTTATATATAGGTAAACATACGTTTTATTCTAGATGAATCCGTTTGCGTTTTCGAGTAAACCAGCTACAT
TTGCCGGAAAGAATATCTAG

Downstream 100 bases:

>100_bases
TATTTCTTACATTTGTAAGGATTAAAAATAGAAAGTTATGAATGAACAGATCATAGAGTTCTTGACAGAGTTGAGGAGCC
ATAACAATCGGGAATGGTTC

Product: hypothetical protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 734; Mature: 734

Protein sequence:

>734_residues
MRKFLLLWLVGLMLVPSVMAERKKVGLVLGGGGAKGVAHIGVLKVLEEAGIPIDYIAGTSMGAIVGGLYSVGYNAAEIDS
MVRLQDWSMLLSDRVKRSSLTFPEKENSERYVFSLPFGRSKKEIAIQGMIKGQNLQNLFSNLTIGYHDSVDFNQLNIPFA
CVALNVVDGQEYVFHHGSLPLAMRASMAIPAVFAPVRLDSMVLVDGGIKNNYPADVARDMGADIIIGVDLGTSDLKQLER
INTPWDIVGQIVALHGYEKYGPNKEQTDLLFRPNTDPYNSASFGETALDTLIDRGEQVARKQWDEILALKKKIGLSDSSD
MHRKRLVHSYPVAPTDTFHIRRVLFEGIDPRDEKWLTQISGLKENSLLTVKKLQEAMSIVIGTNLYSNVSYKLVGERQED
LVLTVQEKSNSAINVGLNFNSEDIVALLLNVTFDNRARYHSKFSVTGRIGKRMYGRVDYAIERNPLRNINLSYMFTYHDL
DVYNRGDKIVNTTYRHHFVELGYSDMNWLNFKLKLGARYEYFDYNSFLYTAENQKYQVKPEGFISYFAQAHLETLDRRYF
PSKGVSLQADYSIYTDNFVTYKGHTFFSALKLSFLSVLPLTSHLSLLPSIDGRVLIGKDPAYPFLNVVGGDMPARYLPQQ
LPFAGINHMEIFDNSVAIVRLNLRQRIGQRHYISLIANYAIHENNFFDLFKGESVWGGSIGYAYNSIVGPMNTNFGLSNR
NNNLQFYLNLGYSF

Sequences:

>Translated_734_residues
MRKFLLLWLVGLMLVPSVMAERKKVGLVLGGGGAKGVAHIGVLKVLEEAGIPIDYIAGTSMGAIVGGLYSVGYNAAEIDS
MVRLQDWSMLLSDRVKRSSLTFPEKENSERYVFSLPFGRSKKEIAIQGMIKGQNLQNLFSNLTIGYHDSVDFNQLNIPFA
CVALNVVDGQEYVFHHGSLPLAMRASMAIPAVFAPVRLDSMVLVDGGIKNNYPADVARDMGADIIIGVDLGTSDLKQLER
INTPWDIVGQIVALHGYEKYGPNKEQTDLLFRPNTDPYNSASFGETALDTLIDRGEQVARKQWDEILALKKKIGLSDSSD
MHRKRLVHSYPVAPTDTFHIRRVLFEGIDPRDEKWLTQISGLKENSLLTVKKLQEAMSIVIGTNLYSNVSYKLVGERQED
LVLTVQEKSNSAINVGLNFNSEDIVALLLNVTFDNRARYHSKFSVTGRIGKRMYGRVDYAIERNPLRNINLSYMFTYHDL
DVYNRGDKIVNTTYRHHFVELGYSDMNWLNFKLKLGARYEYFDYNSFLYTAENQKYQVKPEGFISYFAQAHLETLDRRYF
PSKGVSLQADYSIYTDNFVTYKGHTFFSALKLSFLSVLPLTSHLSLLPSIDGRVLIGKDPAYPFLNVVGGDMPARYLPQQ
LPFAGINHMEIFDNSVAIVRLNLRQRIGQRHYISLIANYAIHENNFFDLFKGESVWGGSIGYAYNSIVGPMNTNFGLSNR
NNNLQFYLNLGYSF
>Mature_734_residues
MRKFLLLWLVGLMLVPSVMAERKKVGLVLGGGGAKGVAHIGVLKVLEEAGIPIDYIAGTSMGAIVGGLYSVGYNAAEIDS
MVRLQDWSMLLSDRVKRSSLTFPEKENSERYVFSLPFGRSKKEIAIQGMIKGQNLQNLFSNLTIGYHDSVDFNQLNIPFA
CVALNVVDGQEYVFHHGSLPLAMRASMAIPAVFAPVRLDSMVLVDGGIKNNYPADVARDMGADIIIGVDLGTSDLKQLER
INTPWDIVGQIVALHGYEKYGPNKEQTDLLFRPNTDPYNSASFGETALDTLIDRGEQVARKQWDEILALKKKIGLSDSSD
MHRKRLVHSYPVAPTDTFHIRRVLFEGIDPRDEKWLTQISGLKENSLLTVKKLQEAMSIVIGTNLYSNVSYKLVGERQED
LVLTVQEKSNSAINVGLNFNSEDIVALLLNVTFDNRARYHSKFSVTGRIGKRMYGRVDYAIERNPLRNINLSYMFTYHDL
DVYNRGDKIVNTTYRHHFVELGYSDMNWLNFKLKLGARYEYFDYNSFLYTAENQKYQVKPEGFISYFAQAHLETLDRRYF
PSKGVSLQADYSIYTDNFVTYKGHTFFSALKLSFLSVLPLTSHLSLLPSIDGRVLIGKDPAYPFLNVVGGDMPARYLPQQ
LPFAGINHMEIFDNSVAIVRLNLRQRIGQRHYISLIANYAIHENNFFDLFKGESVWGGSIGYAYNSIVGPMNTNFGLSNR
NNNLQFYLNLGYSF

Specific function: Unknown

COG id: COG1752

COG function: function code R; Predicted esterase of the alpha-beta hydrolase superfamily

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 patatin domain [H]

Homologues:

Organism=Homo sapiens, GI148727335, Length=213, Percent_Identity=34.7417840375587, Blast_Score=117, Evalue=5e-26,
Organism=Homo sapiens, GI148727290, Length=213, Percent_Identity=34.7417840375587, Blast_Score=116, Evalue=6e-26,
Organism=Homo sapiens, GI260656039, Length=332, Percent_Identity=28.0120481927711, Blast_Score=112, Evalue=1e-24,
Organism=Homo sapiens, GI260656041, Length=332, Percent_Identity=28.0120481927711, Blast_Score=112, Evalue=1e-24,
Organism=Homo sapiens, GI116256487, Length=332, Percent_Identity=28.0120481927711, Blast_Score=112, Evalue=1e-24,
Organism=Homo sapiens, GI260656043, Length=332, Percent_Identity=28.0120481927711, Blast_Score=112, Evalue=2e-24,
Organism=Homo sapiens, GI260656037, Length=332, Percent_Identity=28.0120481927711, Blast_Score=112, Evalue=2e-24,
Organism=Escherichia coli, GI226510936, Length=209, Percent_Identity=33.0143540669856, Blast_Score=110, Evalue=3e-25,
Organism=Caenorhabditis elegans, GI71997299, Length=194, Percent_Identity=27.319587628866, Blast_Score=76, Evalue=5e-14,
Organism=Caenorhabditis elegans, GI71997289, Length=194, Percent_Identity=27.319587628866, Blast_Score=76, Evalue=5e-14,
Organism=Caenorhabditis elegans, GI193204778, Length=218, Percent_Identity=28.4403669724771, Blast_Score=74, Evalue=4e-13,
Organism=Saccharomyces cerevisiae, GI6323581, Length=218, Percent_Identity=31.1926605504587, Blast_Score=103, Evalue=1e-22,
Organism=Drosophila melanogaster, GI281376913, Length=236, Percent_Identity=33.0508474576271, Blast_Score=93, Evalue=9e-19,
Organism=Drosophila melanogaster, GI28571388, Length=236, Percent_Identity=32.2033898305085, Blast_Score=90, Evalue=4e-18,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR016035
- InterPro:   IPR001423
- InterPro:   IPR002641 [H]

Pfam domain/function: PF01734 Patatin [H]

EC number: NA

Molecular weight: Translated: 82817; Mature: 82817

Theoretical pI: Translated: 8.52; Mature: 8.52

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.1 %Cys     (Translated Protein)
2.6 %Met     (Translated Protein)
2.7 %Cys+Met (Translated Protein)
0.1 %Cys     (Mature Protein)
2.6 %Met     (Mature Protein)
2.7 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MRKFLLLWLVGLMLVPSVMAERKKVGLVLGGGGAKGVAHIGVLKVLEEAGIPIDYIAGTS
CCHHHHHHHHHHHHHHHHHHCHHHEEEEEECCCCCCHHHHHHHHHHHHCCCCEEEECCCC
MGAIVGGLYSVGYNAAEIDSMVRLQDWSMLLSDRVKRSSLTFPEKENSERYVFSLPFGRS
HHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCEEEEECCCCCC
KKEIAIQGMIKGQNLQNLFSNLTIGYHDSVDFNQLNIPFACVALNVVDGQEYVFHHGSLP
CCEEEEEEEECCCCHHHHHHCCEECCCCCCCCCCCCCCEEEEEEEEECCCEEEEECCCCC
LAMRASMAIPAVFAPVRLDSMVLVDGGIKNNYPADVARDMGADIIIGVDLGTSDLKQLER
HHHHHHHCCCCEEECEEECEEEEEECCCCCCCCHHHHHHCCCCEEEEECCCHHHHHHHHH
INTPWDIVGQIVALHGYEKYGPNKEQTDLLFRPNTDPYNSASFGETALDTLIDRGEQVAR
CCCCHHHHHHHHHHCCHHHCCCCCCCCEEEECCCCCCCCCCCCCHHHHHHHHHCHHHHHH
KQWDEILALKKKIGLSDSSDMHRKRLVHSYPVAPTDTFHIRRVLFEGIDPRDEKWLTQIS
HHHHHHHHHHHHCCCCCCCHHHHHHHHHHCCCCCCCHHHHHHHHHCCCCCCHHHHHHHHC
GLKENSLLTVKKLQEAMSIVIGTNLYSNVSYKLVGERQEDLVLTVQEKSNSAINVGLNFN
CCCCCCEEHHHHHHHHHHEEECCCHHCCCEEEEECCCCCCEEEEEEECCCCEEEEEECCC
SEDIVALLLNVTFDNRARYHSKFSVTGRIGKRMYGRVDYAIERNPLRNINLSYMFTYHDL
CCCEEEEEEECCCCCCCCCCCEEEEEHHHHHHHHCCEEEEEECCCCCCCCEEEEEEEECC
DVYNRGDKIVNTTYRHHFVELGYSDMNWLNFKLKLGARYEYFDYNSFLYTAENQKYQVKP
EEECCCCCEEECHHHHEEEEECCCCCCEEEEEEEECCEEEEEECCCEEEEECCCEEEECC
EGFISYFAQAHLETLDRRYFPSKGVSLQADYSIYTDNFVTYKGHTFFSALKLSFLSVLPL
HHHHHHHHHHHHHHHHHHCCCCCCCEEEECEEEEECCEEEECCCHHHHHHHHHHHHHHHH
TSHLSLLPSIDGRVLIGKDPAYPFLNVVGGDMPARYLPQQLPFAGINHMEIFDNSVAIVR
HHHHHHCCCCCCEEEEECCCCCCHHHHCCCCCCHHHCCCCCCCCCCCCEEEECCCEEEEE
LNLRQRIGQRHYISLIANYAIHENNFFDLFKGESVWGGSIGYAYNSIVGPMNTNFGLSNR
EEHHHHCCCHHHHHHHHHHEEECCCEEEEECCCCCCCCCCCHHHHHCCCCCCCCCCCCCC
NNNLQFYLNLGYSF
CCCEEEEEEECCCC
>Mature Secondary Structure
MRKFLLLWLVGLMLVPSVMAERKKVGLVLGGGGAKGVAHIGVLKVLEEAGIPIDYIAGTS
CCHHHHHHHHHHHHHHHHHHCHHHEEEEEECCCCCCHHHHHHHHHHHHCCCCEEEECCCC
MGAIVGGLYSVGYNAAEIDSMVRLQDWSMLLSDRVKRSSLTFPEKENSERYVFSLPFGRS
HHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCEEEEECCCCCC
KKEIAIQGMIKGQNLQNLFSNLTIGYHDSVDFNQLNIPFACVALNVVDGQEYVFHHGSLP
CCEEEEEEEECCCCHHHHHHCCEECCCCCCCCCCCCCCEEEEEEEEECCCEEEEECCCCC
LAMRASMAIPAVFAPVRLDSMVLVDGGIKNNYPADVARDMGADIIIGVDLGTSDLKQLER
HHHHHHHCCCCEEECEEECEEEEEECCCCCCCCHHHHHHCCCCEEEEECCCHHHHHHHHH
INTPWDIVGQIVALHGYEKYGPNKEQTDLLFRPNTDPYNSASFGETALDTLIDRGEQVAR
CCCCHHHHHHHHHHCCHHHCCCCCCCCEEEECCCCCCCCCCCCCHHHHHHHHHCHHHHHH
KQWDEILALKKKIGLSDSSDMHRKRLVHSYPVAPTDTFHIRRVLFEGIDPRDEKWLTQIS
HHHHHHHHHHHHCCCCCCCHHHHHHHHHHCCCCCCCHHHHHHHHHCCCCCCHHHHHHHHC
GLKENSLLTVKKLQEAMSIVIGTNLYSNVSYKLVGERQEDLVLTVQEKSNSAINVGLNFN
CCCCCCEEHHHHHHHHHHEEECCCHHCCCEEEEECCCCCCEEEEEEECCCCEEEEEECCC
SEDIVALLLNVTFDNRARYHSKFSVTGRIGKRMYGRVDYAIERNPLRNINLSYMFTYHDL
CCCEEEEEEECCCCCCCCCCCEEEEEHHHHHHHHCCEEEEEECCCCCCCCEEEEEEEECC
DVYNRGDKIVNTTYRHHFVELGYSDMNWLNFKLKLGARYEYFDYNSFLYTAENQKYQVKP
EEECCCCCEEECHHHHEEEEECCCCCCEEEEEEEECCEEEEEECCCEEEEECCCEEEECC
EGFISYFAQAHLETLDRRYFPSKGVSLQADYSIYTDNFVTYKGHTFFSALKLSFLSVLPL
HHHHHHHHHHHHHHHHHHCCCCCCCEEEECEEEEECCEEEECCCHHHHHHHHHHHHHHHH
TSHLSLLPSIDGRVLIGKDPAYPFLNVVGGDMPARYLPQQLPFAGINHMEIFDNSVAIVR
HHHHHHCCCCCCEEEEECCCCCCHHHHCCCCCCHHHCCCCCCCCCCCCEEEECCCEEEEE
LNLRQRIGQRHYISLIANYAIHENNFFDLFKGESVWGGSIGYAYNSIVGPMNTNFGLSNR
EEHHHHCCCHHHHHHHHHHEEECCCEEEEECCCCCCCCCCCHHHHHCCCCCCCCCCCCCC
NNNLQFYLNLGYSF
CCCEEEEEEECCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 9384377 [H]