The gene/protein map for NC_009708 is currently unavailable.
Definition Yersinia pseudotuberculosis IP 31758, complete genome.
Accession NC_009708
Length 4,723,306

Click here to switch to the map view.

The map label for this gene is bioH

Identifier: 153950185

GI number: 153950185

Start: 4473566

End: 4474342

Strand: Reverse

Name: bioH

Synonym: YpsIP31758_3988

Alternate gene names: 153950185

Gene position: 4474342-4473566 (Counterclockwise)

Preceding gene: 153949797

Following gene: 153950937

Centisome position: 94.73

GC content: 52.51

Gene sequence:

>777_bases
ATGAAGCAGCTTTATTGGTACACCTGCGGTGAAGGCGATTGCGATCTTGTGTTGTTGCACGGATGGGGGCTGAATAGCGG
GGTATGGCATTGCATTATTGATCGACTTGCGCCGCATTTTCGTCTGCATTTGGTGGACCTGCCGGGTTATGGGCGCAGCC
AAGATTATGGTGCGATGTCACTGGCTGACATGGCCGAGAGAGTGGCACAGCAAGCGCCGAAACAGGCATTGTGGCTTGGG
TGGTCAATGGGGGGATTGGTCGCTAGCCAAATAGCCCTGAGCCAGCCAGAGTGTGTCAGGGGGCTGATCACCGTCTCCTC
TTCTCCCTGCTTTACCGCGCGTGATGAATGGCCGGGTATCAAGCCGGAAGTGCTGGCAGGTTTTCAACATCAGCTAAGTG
ATGATTTTCATCGGACAGTAGAACGCTTTTTGGCCTTGCAAACCTTAGGGACTGAAAGTTCGCGTCAGGATGCCCGTTTG
CTAAAATCTGTCGTGCTACAGCATCAAATGCCCGATGTTGAGGTATTGACCGGGGGGTTGGCGATCTTGCGCACGGCGGA
TCTACGTACAGCACTGGCTGGTTTTACGCTGCCTTTTATGCGCGTTTACGGTCATCTGGACAGTTTGGTCCCACGTAAAG
TGGCATCGCTATTAGACAGCGCCTGGCCGCAAACCCAGTCGGTGGTCATGCAAGGGGCTGCTCATGCCCCCTTTATTTCT
CACCCCAATGATTTCGCCAAATTAATCCTGAATTTTGCTGAAGAAAACAAAAAATAA

Upstream 100 bases:

>100_bases
ACGGTTGTTAGCATAGGTATCTTCCTTGATTTTAGTGCCCTTTTAGTGAGCTAAATCACCTGACAGGGCTGTTATTCTTA
TGGCAACAGGATATTACTGT

Downstream 100 bases:

>100_bases
TGGCGTTAGCTTCTTATTTTCTCTCTCTATTTTTACTGCCCAGCCTATATTGGTTGGGTAAAATGGTTGTGTAAAAGAAA
ATTATTTAAGTTATTAAATG

Product: carboxylesterase bioH

Products: NA

Alternate protein names: Biotin synthesis protein BioH

Number of amino acids: Translated: 258; Mature: 258

Protein sequence:

>258_residues
MKQLYWYTCGEGDCDLVLLHGWGLNSGVWHCIIDRLAPHFRLHLVDLPGYGRSQDYGAMSLADMAERVAQQAPKQALWLG
WSMGGLVASQIALSQPECVRGLITVSSSPCFTARDEWPGIKPEVLAGFQHQLSDDFHRTVERFLALQTLGTESSRQDARL
LKSVVLQHQMPDVEVLTGGLAILRTADLRTALAGFTLPFMRVYGHLDSLVPRKVASLLDSAWPQTQSVVMQGAAHAPFIS
HPNDFAKLILNFAEENKK

Sequences:

>Translated_258_residues
MKQLYWYTCGEGDCDLVLLHGWGLNSGVWHCIIDRLAPHFRLHLVDLPGYGRSQDYGAMSLADMAERVAQQAPKQALWLG
WSMGGLVASQIALSQPECVRGLITVSSSPCFTARDEWPGIKPEVLAGFQHQLSDDFHRTVERFLALQTLGTESSRQDARL
LKSVVLQHQMPDVEVLTGGLAILRTADLRTALAGFTLPFMRVYGHLDSLVPRKVASLLDSAWPQTQSVVMQGAAHAPFIS
HPNDFAKLILNFAEENKK
>Mature_258_residues
MKQLYWYTCGEGDCDLVLLHGWGLNSGVWHCIIDRLAPHFRLHLVDLPGYGRSQDYGAMSLADMAERVAQQAPKQALWLG
WSMGGLVASQIALSQPECVRGLITVSSSPCFTARDEWPGIKPEVLAGFQHQLSDDFHRTVERFLALQTLGTESSRQDARL
LKSVVLQHQMPDVEVLTGGLAILRTADLRTALAGFTLPFMRVYGHLDSLVPRKVASLLDSAWPQTQSVVMQGAAHAPFIS
HPNDFAKLILNFAEENKK

Specific function: Shows carboxylesterase activity with a preference for short chain fatty acid esters (acyl chain length of up to 6 carbons). Also displays a weak thioesterase activity. Can form a complex with CoA, and may be involved in the condensation of CoA and pimelic

COG id: COG0596

COG function: function code R; Predicted hydrolases or acyltransferases (alpha/beta hydrolase superfamily)

Gene ontology:

Cell location: Cytoplasm

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the AB hydrolase superfamily. Carboxylesterase BioH family

Homologues:

Organism=Escherichia coli, GI1789817, Length=255, Percent_Identity=64.3137254901961, Blast_Score=353, Evalue=7e-99,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): BIOH_YERP3 (A7FNV8)

Other databases:

- EMBL:   CP000720
- RefSeq:   YP_001402936.1
- ProteinModelPortal:   A7FNV8
- STRING:   A7FNV8
- GeneID:   5387769
- GenomeReviews:   CP000720_GR
- KEGG:   ypi:YpsIP31758_3988
- eggNOG:   COG0596
- HOGENOM:   HBG748003
- OMA:   QGPDLVM
- ProtClustDB:   CLSK888408
- BioCyc:   YPSE349747:YPSIP31758_3988-MONOMER
- GO:   GO:0005737
- HAMAP:   MF_01260
- InterPro:   IPR000073
- InterPro:   IPR010076
- TIGRFAMs:   TIGR01738

Pfam domain/function: PF00561 Abhydrolase_1

EC number: =3.1.1.1

Molecular weight: Translated: 28590; Mature: 28590

Theoretical pI: Translated: 6.85; Mature: 6.85

Prosite motif: NA

Important sites: ACT_SITE 82-82 ACT_SITE 207-207 ACT_SITE 235-235

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.9 %Cys     (Translated Protein)
2.7 %Met     (Translated Protein)
4.7 %Cys+Met (Translated Protein)
1.9 %Cys     (Mature Protein)
2.7 %Met     (Mature Protein)
4.7 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKQLYWYTCGEGDCDLVLLHGWGLNSGVWHCIIDRLAPHFRLHLVDLPGYGRSQDYGAMS
CCEEEEEECCCCCCCEEEEECCCCCCCHHHHHHHHHCCCEEEEEEECCCCCCCCCCCHHH
LADMAERVAQQAPKQALWLGWSMGGLVASQIALSQPECVRGLITVSSSPCFTARDEWPGI
HHHHHHHHHHHCCHHHHHHCCCHHHHHHHHHHCCCCHHHHHHHEECCCCCCCCCCCCCCC
KPEVLAGFQHQLSDDFHRTVERFLALQTLGTESSRQDARLLKSVVLQHQMPDVEVLTGGL
CHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHCCCCHHHHHCCH
AILRTADLRTALAGFTLPFMRVYGHLDSLVPRKVASLLDSAWPQTQSVVMQGAAHAPFIS
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHCCCCCCCCC
HPNDFAKLILNFAEENKK
CCHHHHHHHHHHHHHCCC
>Mature Secondary Structure
MKQLYWYTCGEGDCDLVLLHGWGLNSGVWHCIIDRLAPHFRLHLVDLPGYGRSQDYGAMS
CCEEEEEECCCCCCCEEEEECCCCCCCHHHHHHHHHCCCEEEEEEECCCCCCCCCCCHHH
LADMAERVAQQAPKQALWLGWSMGGLVASQIALSQPECVRGLITVSSSPCFTARDEWPGI
HHHHHHHHHHHCCHHHHHHCCCHHHHHHHHHHCCCCHHHHHHHEECCCCCCCCCCCCCCC
KPEVLAGFQHQLSDDFHRTVERFLALQTLGTESSRQDARLLKSVVLQHQMPDVEVLTGGL
CHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHCCCCHHHHHCCH
AILRTADLRTALAGFTLPFMRVYGHLDSLVPRKVASLLDSAWPQTQSVVMQGAAHAPFIS
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHCCCCCCCCC
HPNDFAKLILNFAEENKK
CCHHHHHHHHHHHHHCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: NA