Definition Parabacteroides distasonis ATCC 8503 chromosome, complete genome.
Accession NC_009615
Length 4,811,379

Click here to switch to the map view.

The map label for this gene is 150009535

Identifier: 150009535

GI number: 150009535

Start: 3529360

End: 3531435

Strand: Direct

Name: 150009535

Synonym: BDI_2948

Alternate gene names: NA

Gene position: 3529360-3531435 (Clockwise)

Preceding gene: 150009534

Following gene: 150009536

Centisome position: 73.35

GC content: 52.07

Gene sequence:

>2076_bases
ATGAGAAAAATAATAGGAATCTTATCCATCTTCCTCGCTTTCGCTCTCATGGGGCAAGCGCAAAGAATCAAGGTGGCTTG
CGTAGGTAATAGCGTGACCTACGGCTACGGAATCGAGAACAGGGAAACAAACTGCTACCCGGCCCAATTGCAACAGATGC
TTGGAGATGCCTACGAAGTGGAGAACTTCGGGCATAGCGGGGCTACTTTATTAAACAAGGGATATCGTCCTTATACCCAA
CAAGAGGCGTATCAAAAGGCACTGAGGTTTGCCGGGGATTACGTGATCATCCATCTGGGATTGAACGATACGGACCCTCG
GGCATGGCCGAATTACCGGGACGATTTCGTTCGGGATTATCTTTCCTTGATCGAATCTTTCCGGAAAGCCAATCCGAAAT
GCAAGGTATGGGTTTGCCGTATGACTCCGATATCTCACCGCCATCCTCGTTTTAAATCCGGTACAAGAGACTGGTACTGG
ATGGAGCAAGCGCTTATCGAAGAAATCGCCCGGATAGCCGGCGCGACCTTGGTCGATTTGCAGGAAGGATTATATGACCG
TCCGGATCTATTGCCCGACGCATTGCATCCAAACGCTGAAGGTGCCGGTATCTTGGCCCGCACCGTTTATGGGGCGCTAA
CCGGAGATTACGGAGGATTACAGCTTCCTGACATCTATTCGGACCGGATGGTCTTGCAACGGGATCAACCGCTTCCTATA
TCTGGCATCGCCAACCAAGGGGAGAAAGTAACCGTTACCCTCGCCGGACAAAGGAAGGAGACCGTAGCCGGTACGAACGG
GAAATGGACTGTCACGCTCGACCCCTTGCGGGTAAGCGGGAAATCCTATACCTTAACGGTTTCTACCCCCAGCCGCACGC
TGAACTATCGGGATGTAGTAGCCGGGGAAGTCTGGCTATGCTCCGGACAATCCAACATGGCGTTCCGGGTAAACGAGAGC
GTAAAGGAAGAACAACAGCAACAATTGGATTACGCGAAACAACACTCGCAAATCCGTTTATTCGACCTAAAGCCCCGCTG
GGAGACCTACGCCGTGGAATGGGACGCTTCCGTACTGGATTCATTGAACCGCCTGCAATATTACCACGACGCCCAATGGG
AAGTATGCGACACGCGGAATACCGCACGCTTCTCGGCCATAGGATTTGCCTTCGGGCGTATGCTGGCCGATAGCTTACAA
GTACCCGTAGGATTGATATTGAACGCTGTTGGCGGCTCGCCTACGGAGGCATGGATCGACCGGAAAACACTGGAATTCGA
GTTTCCGGATATCTTACAGGATTGGACGAAGAACGACTTTATCCAAGATTGGGTACGTGAACGGGCGGCCTTAAACATCA
AGCAAGCGTCCAACCCGCTCCAACGCCATCCGTATGAGCCTTGTTATCTGTTCGAGGCGGGTATCCAACCCCTTCATCGA
TATCCCATCAAAGGGATTATTTGGTACCAAGGAGAATCGAACGCCCATAATATGGAAGTACACGAACGATTATTCCCGCT
ATTGGTGAACAGCTGGCGCCAGAATTGGAACGCAGACCTGCCTTTCTACTATGTCCAACTATCCAGCATAGACCGCCCGA
GTTGGACTTGGTTCAGGGACAGCCAACGCCGCCTGGCGCAAACCGTATCGAATACGGGTATGGCCGTTAGTAGCGATCGC
GGGGATTCTTTAAACGTTCACCCTACCCGAAAAAAAGAGATTGGCGAACGACTGGCACATTGGGCCTTGAACAAGACCTA
CGGACATAACGTAATCCCATCCGGCCCTTTGTTCCGCAGCGCAACGTTTACCGATAACGCCGCCTATATCACTTTCGATT
ACGCAAAGGGCTTAACAACCTCCGATGGGGACCCCATCCGTACATTCGAGATCGCCGAGCAGGAAGGACTTTACTATCCG
GCGCAAGCCGTGGTAGAGAACGGGAAAGTAAAGGTGTGGAACGATCAAGTGACTCACCCGAAGCTGGTACGCTACGGCTG
GCAACCCTTCACGAGAGCGAATCTTGTAAACGAGGCGGGTATGCCGGCCTCTACGTTCCGGGCTATAAAAGAATAA

Upstream 100 bases:

>100_bases
TACGTTCGTTTGCGTCACCCCGGATGGAGAGAAAGCGGTGGAAGGACTGGTTTACTCTCCGGATAAACAACTTAAATAAC
GTCTAATTCGGTTGAATGAA

Downstream 100 bases:

>100_bases
GCTATGCATAATAAACAACAAATCACCGGTTGGCTGTTCTTCCTGCTACTCTGCGTAGCGGGATGCGGCCAGCCTGTATC
TAAAAAACAGAACACCATGA

Product: sialate O-acetylesterase

Products: NA

Alternate protein names: Sialic Acid-Specific 9-O-Acetylesterase; Conserved Domain Protein; Lipolytic Protein G-D-S-L Family; Xylanase; Hydrolase Protein; Sialic Acid-Specific 9-O-Acetylesterase-Like Protein; Secreted Protein; Sialic Acid-Specific Acetylesterase; GDSL-Like Protein; Sialate O-Acetylesterase Homolog; Sialic-Acid O-Acetylesterase; LPXTG-Motif Cell Wall Anchor Domain-Containing Protein; Glycoside Hydrolase Family Protein; Acetylesterase/GDSL-Like Lipase/Acylhydrolase; Esterase; Glycosyl Hydrolase; Acetyl-Xylan Esterase; Sialic Acidspecific 9-O-Acetylesterase; O-Antigen-Like Protein

Number of amino acids: Translated: 691; Mature: 691

Protein sequence:

>691_residues
MRKIIGILSIFLAFALMGQAQRIKVACVGNSVTYGYGIENRETNCYPAQLQQMLGDAYEVENFGHSGATLLNKGYRPYTQ
QEAYQKALRFAGDYVIIHLGLNDTDPRAWPNYRDDFVRDYLSLIESFRKANPKCKVWVCRMTPISHRHPRFKSGTRDWYW
MEQALIEEIARIAGATLVDLQEGLYDRPDLLPDALHPNAEGAGILARTVYGALTGDYGGLQLPDIYSDRMVLQRDQPLPI
SGIANQGEKVTVTLAGQRKETVAGTNGKWTVTLDPLRVSGKSYTLTVSTPSRTLNYRDVVAGEVWLCSGQSNMAFRVNES
VKEEQQQQLDYAKQHSQIRLFDLKPRWETYAVEWDASVLDSLNRLQYYHDAQWEVCDTRNTARFSAIGFAFGRMLADSLQ
VPVGLILNAVGGSPTEAWIDRKTLEFEFPDILQDWTKNDFIQDWVRERAALNIKQASNPLQRHPYEPCYLFEAGIQPLHR
YPIKGIIWYQGESNAHNMEVHERLFPLLVNSWRQNWNADLPFYYVQLSSIDRPSWTWFRDSQRRLAQTVSNTGMAVSSDR
GDSLNVHPTRKKEIGERLAHWALNKTYGHNVIPSGPLFRSATFTDNAAYITFDYAKGLTTSDGDPIRTFEIAEQEGLYYP
AQAVVENGKVKVWNDQVTHPKLVRYGWQPFTRANLVNEAGMPASTFRAIKE

Sequences:

>Translated_691_residues
MRKIIGILSIFLAFALMGQAQRIKVACVGNSVTYGYGIENRETNCYPAQLQQMLGDAYEVENFGHSGATLLNKGYRPYTQ
QEAYQKALRFAGDYVIIHLGLNDTDPRAWPNYRDDFVRDYLSLIESFRKANPKCKVWVCRMTPISHRHPRFKSGTRDWYW
MEQALIEEIARIAGATLVDLQEGLYDRPDLLPDALHPNAEGAGILARTVYGALTGDYGGLQLPDIYSDRMVLQRDQPLPI
SGIANQGEKVTVTLAGQRKETVAGTNGKWTVTLDPLRVSGKSYTLTVSTPSRTLNYRDVVAGEVWLCSGQSNMAFRVNES
VKEEQQQQLDYAKQHSQIRLFDLKPRWETYAVEWDASVLDSLNRLQYYHDAQWEVCDTRNTARFSAIGFAFGRMLADSLQ
VPVGLILNAVGGSPTEAWIDRKTLEFEFPDILQDWTKNDFIQDWVRERAALNIKQASNPLQRHPYEPCYLFEAGIQPLHR
YPIKGIIWYQGESNAHNMEVHERLFPLLVNSWRQNWNADLPFYYVQLSSIDRPSWTWFRDSQRRLAQTVSNTGMAVSSDR
GDSLNVHPTRKKEIGERLAHWALNKTYGHNVIPSGPLFRSATFTDNAAYITFDYAKGLTTSDGDPIRTFEIAEQEGLYYP
AQAVVENGKVKVWNDQVTHPKLVRYGWQPFTRANLVNEAGMPASTFRAIKE
>Mature_691_residues
MRKIIGILSIFLAFALMGQAQRIKVACVGNSVTYGYGIENRETNCYPAQLQQMLGDAYEVENFGHSGATLLNKGYRPYTQ
QEAYQKALRFAGDYVIIHLGLNDTDPRAWPNYRDDFVRDYLSLIESFRKANPKCKVWVCRMTPISHRHPRFKSGTRDWYW
MEQALIEEIARIAGATLVDLQEGLYDRPDLLPDALHPNAEGAGILARTVYGALTGDYGGLQLPDIYSDRMVLQRDQPLPI
SGIANQGEKVTVTLAGQRKETVAGTNGKWTVTLDPLRVSGKSYTLTVSTPSRTLNYRDVVAGEVWLCSGQSNMAFRVNES
VKEEQQQQLDYAKQHSQIRLFDLKPRWETYAVEWDASVLDSLNRLQYYHDAQWEVCDTRNTARFSAIGFAFGRMLADSLQ
VPVGLILNAVGGSPTEAWIDRKTLEFEFPDILQDWTKNDFIQDWVRERAALNIKQASNPLQRHPYEPCYLFEAGIQPLHR
YPIKGIIWYQGESNAHNMEVHERLFPLLVNSWRQNWNADLPFYYVQLSSIDRPSWTWFRDSQRRLAQTVSNTGMAVSSDR
GDSLNVHPTRKKEIGERLAHWALNKTYGHNVIPSGPLFRSATFTDNAAYITFDYAKGLTTSDGDPIRTFEIAEQEGLYYP
AQAVVENGKVKVWNDQVTHPKLVRYGWQPFTRANLVNEAGMPASTFRAIKE

Specific function: Unknown

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

Organism=Homo sapiens, GI24850115, Length=455, Percent_Identity=28.3516483516484, Blast_Score=130, Evalue=6e-30,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 78769; Mature: 78769

Theoretical pI: Translated: 7.22; Mature: 7.22

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.0 %Cys     (Translated Protein)
1.6 %Met     (Translated Protein)
2.6 %Cys+Met (Translated Protein)
1.0 %Cys     (Mature Protein)
1.6 %Met     (Mature Protein)
2.6 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MRKIIGILSIFLAFALMGQAQRIKVACVGNSVTYGYGIENRETNCYPAQLQQMLGDAYEV
CHHHHHHHHHHHHHHHHCCCCEEEEEEECCCEEEECCCCCCCCCCCHHHHHHHHCCHHHH
ENFGHSGATLLNKGYRPYTQQEAYQKALRFAGDYVIIHLGLNDTDPRAWPNYRDDFVRDY
HCCCCCCHHHHHCCCCCCHHHHHHHHHHHHCCCEEEEEECCCCCCCCCCCCHHHHHHHHH
LSLIESFRKANPKCKVWVCRMTPISHRHPRFKSGTRDWYWMEQALIEEIARIAGATLVDL
HHHHHHHHHCCCCEEEEEEEECCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHCCCHHHH
QEGLYDRPDLLPDALHPNAEGAGILARTVYGALTGDYGGLQLPDIYSDRMVLQRDQPLPI
HHCCCCCCCCCCHHCCCCCCCCCHHHHHHHHHHCCCCCCCCCCCCCCCCEEEECCCCCCC
SGIANQGEKVTVTLAGQRKETVAGTNGKWTVTLDPLRVSGKSYTLTVSTPSRTLNYRDVV
CCCCCCCCEEEEEEECCCCCEECCCCCEEEEEECCEEECCCEEEEEEECCCCCCCHHHEE
AGEVWLCSGQSNMAFRVNESVKEEQQQQLDYAKQHSQIRLFDLKPRWETYAVEWDASVLD
ECEEEEECCCCCEEEEECHHHHHHHHHHHHHHHHCCCEEEEECCCCCEEEEEEECHHHHH
SLNRLQYYHDAQWEVCDTRNTARFSAIGFAFGRMLADSLQVPVGLILNAVGGSPTEAWID
HHHHHHHHCCCCEEEECCCCCCHHHHHHHHHHHHHHHHHCCCHHHHHCCCCCCCHHHHHC
RKTLEFEFPDILQDWTKNDFIQDWVRERAALNIKQASNPLQRHPYEPCYLFEAGIQPLHR
CCEEEECCHHHHHHHCCCHHHHHHHHHHHHEEHHHCCCCHHHCCCCCEEEEHHCCCHHHH
YPIKGIIWYQGESNAHNMEVHERLFPLLVNSWRQNWNADLPFYYVQLSSIDRPSWTWFRD
CCCCEEEEECCCCCCCCHHHHHHHHHHHHHHHHHCCCCCCCEEEEEEECCCCCCCCHHHH
SQRRLAQTVSNTGMAVSSDRGDSLNVHPTRKKEIGERLAHWALNKTYGHNVIPSGPLFRS
HHHHHHHHHHHCCCEEECCCCCCCCCCCCHHHHHHHHHHHHHHCCCCCCCCCCCCCCEEE
ATFTDNAAYITFDYAKGLTTSDGDPIRTFEIAEQEGLYYPAQAVVENGKVKVWNDQVTHP
EEECCCEEEEEEECCCCCCCCCCCCEEEEEEHHHCCCCCCHHHHHCCCCEEEECCCCCCC
KLVRYGWQPFTRANLVNEAGMPASTFRAIKE
HHHHCCCCCCHHHHHHHCCCCCHHHHHHHCC
>Mature Secondary Structure
MRKIIGILSIFLAFALMGQAQRIKVACVGNSVTYGYGIENRETNCYPAQLQQMLGDAYEV
CHHHHHHHHHHHHHHHHCCCCEEEEEEECCCEEEECCCCCCCCCCCHHHHHHHHCCHHHH
ENFGHSGATLLNKGYRPYTQQEAYQKALRFAGDYVIIHLGLNDTDPRAWPNYRDDFVRDY
HCCCCCCHHHHHCCCCCCHHHHHHHHHHHHCCCEEEEEECCCCCCCCCCCCHHHHHHHHH
LSLIESFRKANPKCKVWVCRMTPISHRHPRFKSGTRDWYWMEQALIEEIARIAGATLVDL
HHHHHHHHHCCCCEEEEEEEECCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHCCCHHHH
QEGLYDRPDLLPDALHPNAEGAGILARTVYGALTGDYGGLQLPDIYSDRMVLQRDQPLPI
HHCCCCCCCCCCHHCCCCCCCCCHHHHHHHHHHCCCCCCCCCCCCCCCCEEEECCCCCCC
SGIANQGEKVTVTLAGQRKETVAGTNGKWTVTLDPLRVSGKSYTLTVSTPSRTLNYRDVV
CCCCCCCCEEEEEEECCCCCEECCCCCEEEEEECCEEECCCEEEEEEECCCCCCCHHHEE
AGEVWLCSGQSNMAFRVNESVKEEQQQQLDYAKQHSQIRLFDLKPRWETYAVEWDASVLD
ECEEEEECCCCCEEEEECHHHHHHHHHHHHHHHHCCCEEEEECCCCCEEEEEEECHHHHH
SLNRLQYYHDAQWEVCDTRNTARFSAIGFAFGRMLADSLQVPVGLILNAVGGSPTEAWID
HHHHHHHHCCCCEEEECCCCCCHHHHHHHHHHHHHHHHHCCCHHHHHCCCCCCCHHHHHC
RKTLEFEFPDILQDWTKNDFIQDWVRERAALNIKQASNPLQRHPYEPCYLFEAGIQPLHR
CCEEEECCHHHHHHHCCCHHHHHHHHHHHHEEHHHCCCCHHHCCCCCEEEEHHCCCHHHH
YPIKGIIWYQGESNAHNMEVHERLFPLLVNSWRQNWNADLPFYYVQLSSIDRPSWTWFRD
CCCCEEEEECCCCCCCCHHHHHHHHHHHHHHHHHCCCCCCCEEEEEEECCCCCCCCHHHH
SQRRLAQTVSNTGMAVSSDRGDSLNVHPTRKKEIGERLAHWALNKTYGHNVIPSGPLFRS
HHHHHHHHHHHCCCEEECCCCCCCCCCCCHHHHHHHHHHHHHHCCCCCCCCCCCCCCEEE
ATFTDNAAYITFDYAKGLTTSDGDPIRTFEIAEQEGLYYPAQAVVENGKVKVWNDQVTHP
EEECCCEEEEEEECCCCCCCCCCCCEEEEEEHHHCCCCCCHHHHHCCCCEEEECCCCCCC
KLVRYGWQPFTRANLVNEAGMPASTFRAIKE
HHHHCCCCCCHHHHHHHCCCCCHHHHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA