Definition Parabacteroides distasonis ATCC 8503 chromosome, complete genome.
Accession NC_009615
Length 4,811,379

Click here to switch to the map view.

The map label for this gene is 150009724

Identifier: 150009724

GI number: 150009724

Start: 3788856

End: 3791516

Strand: Direct

Name: 150009724

Synonym: BDI_3139

Alternate gene names: NA

Gene position: 3788856-3791516 (Clockwise)

Preceding gene: 150009723

Following gene: 150009725

Centisome position: 78.75

GC content: 47.99

Gene sequence:

>2661_bases
ATGAAATGTATATCTATCTACTTTGTGACCCTATTGTTACTGATGTCGGGCTGTGAATCCGGGCGGAGGTTCATCTTAAA
AGATCTTCGTTGTGAGAACTTGGAGAATCCGGTTGCGATCGACAATACCCATCCCCATTTTAGCTGGAAAATCGAGACAG
ACGGGCAAACTATGCGGCAAGCGTATTTTGAGATACAAGTAGCCACGGATAGTTCCTTGCTGGCTCAAGGCAAAGCCGAT
CTATGGAATTCAGGTAAGGTGGAATCGTCCGCTTCCGTGATGGTCCCTTATCGAGGGAAAGAGTTGCGATCTAGTGTGCT
GGCCTATTGGAAAGTCCGGGTATGGGACGATAAGGGGGAATCCTCGGATTGGAGTCCAATCAATCGCTTTGGGATCGGGC
TTTTGGATAAAGCGGAATGGCAAGGGAAATATATAGGGATGCCGGATGAGAAGAATCCGATGTTAAGGAATAAGTTCGAG
CTTCAAGACCGTGATGCCACATTACTCCTTCATGTAAACTCCTTAGGGTATCATGAGATCTATTTAAATGGGAGGAAGGT
ATCGGAAGATGTTCTCTCGCCTGCGGTATCTCAATTAAACAAAAGATCATTATCGGTGACGTACGATCTTACGCCGTACG
CAAAGCAGGGAATAAACGACTTATTGCTCTGGTTGGGCCGTGGCTGGTACAGAAAAGCTACTTTTAATGCCGTTCATGAT
GGGCCGTTGGTTAAACTGCAATTGGACGAGATTCAAAGAAATGGCGCTACAAGTACGTTACTCGTTACAGATAGCTCTTG
GGAAGGCCGGGGAAGTATGTATGGTGAGACCGGTACCGGTACTTGGTATCCCCATCAATTCGGGGGTGAATGTGTGGATG
GGCGGAAGGCGTTGCCGGATTTGACAACGGCTACGCTTGACAAACTGGATTGGACGCCGGTATTGGAGGTGGAGGTACCC
GGGATAGAGGTAAGTCCCCAAATGTGTGAGCCTAATCGAATACAAGAGATTATCCGTCCCAAAGGAATCAAACAAATAGG
GGATAGTATTTGGCTCGTAGATATGGGAAAGGCGTTAAATGGTTGGGTTGAGCTGAGTTTCCCAAAATTACCGGAAGGCC
ACCGGGTCCGTATGGAATATACGGATTGGTTAAATGAAAACGAAGATTTCAAGCCACAAGAGGAGAACGGACAGTATGAG
GATTGGTATATCGGTTCCGGACAAGGCAAAGAGGTATTCCGAAATAAATTTAACCACCATGCGTTTCAATATATAAGGAT
ATCCGGTTTGGCGAAAGCCCCCGAGGAGGTAACCGGCTATCTGATTCATACGGATTATAAGGATGCCTCGTCTTTCGAGT
GCTCGGATCCGGACTTGAATGCTATCTATGCGATGATCAAATATACTTTCAAGAACCTAGCTTTCAGTGGTTATATCGTA
GACTGCCCGCATTATGAGCGTATGGGATACGGTGGGGATGGAAATGCCTCTTGTAAGAGTTTCCAGACATTGTATGAGGG
CTCTTCCGTGTATATGAACTGGATGCAGATGTGGCAGGATTGCATCCGTGAGGATGGGGGTATGCCGCATTGCGTACCGA
GTCCATACCCGGCGGGAGGTGGTCCGTATTGGTGTGGCTTTATTATCACGGGATCGTGGCAGACTTATTTGAATTATGGG
GATAGCCGTCTGATCGAGCGATATTATCCGGTTATGCGACATTGGTTGCGTTATGTGGATGCGTATACGGTCGATGGATT
GCTGAAACGTTGGCCGGATACGGATTATCGGGCATGGTATTTAGGGGATTGGTTGGCTCCGGCGGGTGTCGATTATACGG
CGCAGTCATCGGTAGATCTGGTTAGTAACTGCTTTATAAGCGATTGCCTCACTACGATGGAGAAGATCGCGAAGGTATTG
GGGAAAGCGGAGGATGCCGCTAAGTATAAAGAGCGTCGCCAACGATTGAACGAGCTTATCCAGAAGACTTTCTATGATCC
GGAGAAGAAACAGTACGCTACAGGCTCCCAGATCGATCGGATTTATCCGATGTTGGTCGGCGTGACAGATGAACAGCATA
TGCCCGAGGTAAAGGAAGGTTTATATCGAGAGACATTGGAGAATTGCAAAGGGCATATCGGTTCCGGCTTGGTGGGTGTT
ACAATCTTGACCGATTGGGCGATAAAGGACGGAGAGGCCGATTTTCTCTATTCCATGCTGAAAAAGAGAGAGCTGCCGGG
ATATCTATATATGATCGATCAAGGGGCTTCTACGACTTGGGAATACTGGTCGGGAGAACGTAGTAAGGTTCATAATTGTT
TCAATGGCATTGGCGCTTGGTTCTGTCAGGCGGTCGGAGGGATCTTGCCGGATGAGGATGAGCCGGGCTATAAACATTTC
TTTATCAAACCTCAGATACCGAATGGCGTGACGTGGGCGAGGGCGGCGAGAGAGACCCCTTACGGTACGGCACGTGTGTC
TTGGACTATGGAGAACCGATCGCTTTCCCTCGATCTGGAGATACCGGCGAATAGTATGGCGACCTTTATCGCTCCATTTA
ACGTATCGAATTGTGTGTTAGATGGGAATAATGTAGAAATATCGGCGGGTTCGATCCTGTTGGAAAGTGGAAAACACACG
CTATCGCTGCCTGCGGAATAG

Upstream 100 bases:

>100_bases
GGCTCGCCTTTCTTGTTTAATAAATCTTAATATTTACCGGGGATATAAGTATCGTAAGCCATTAGAAAGTATATTCATGC
GTAATGTCAATCTATTTATC

Downstream 100 bases:

>100_bases
GAATCATATGATTCCCTTTTTGTTGACTTATGTTAATAGCTGTTTTTTAATTATTACGCCGTAAGTGTTTTATTCTATTG
AAGGGTATATAGTATAAAAG

Product: glycoside hydrolase family protein

Products: NA

Alternate protein names: Alpha-Rhamnosidase; Alfa-L-Rhamnosidase; Rhamnosidase; Glycoside Hydrolase Family; Hydrolase; Exported Rhamnosidase A; Secreted Hydrolase; Exported Rhamnosidase Protein; Rhamnosidase A; Alpha-L-Rhamnosidase Protein; Secreted Protein; Glycolsyl Hydrolase Family; Alpha-L-Rhamnosidase N-Terminal Domain-Containing Protein; Exported Rhamnosidase; Glycosyl Hydrolase; Alpha-L-Rhamnosidase Family; Basic Proline-Rich Protein; Bacterial Alpha-L-Rhamnosidase Family; Alpha-L-Rhamnosidase Domain-Containing Protein; Alpha-L-Rhamnosidase Domain Protein

Number of amino acids: Translated: 886; Mature: 886

Protein sequence:

>886_residues
MKCISIYFVTLLLLMSGCESGRRFILKDLRCENLENPVAIDNTHPHFSWKIETDGQTMRQAYFEIQVATDSSLLAQGKAD
LWNSGKVESSASVMVPYRGKELRSSVLAYWKVRVWDDKGESSDWSPINRFGIGLLDKAEWQGKYIGMPDEKNPMLRNKFE
LQDRDATLLLHVNSLGYHEIYLNGRKVSEDVLSPAVSQLNKRSLSVTYDLTPYAKQGINDLLLWLGRGWYRKATFNAVHD
GPLVKLQLDEIQRNGATSTLLVTDSSWEGRGSMYGETGTGTWYPHQFGGECVDGRKALPDLTTATLDKLDWTPVLEVEVP
GIEVSPQMCEPNRIQEIIRPKGIKQIGDSIWLVDMGKALNGWVELSFPKLPEGHRVRMEYTDWLNENEDFKPQEENGQYE
DWYIGSGQGKEVFRNKFNHHAFQYIRISGLAKAPEEVTGYLIHTDYKDASSFECSDPDLNAIYAMIKYTFKNLAFSGYIV
DCPHYERMGYGGDGNASCKSFQTLYEGSSVYMNWMQMWQDCIREDGGMPHCVPSPYPAGGGPYWCGFIITGSWQTYLNYG
DSRLIERYYPVMRHWLRYVDAYTVDGLLKRWPDTDYRAWYLGDWLAPAGVDYTAQSSVDLVSNCFISDCLTTMEKIAKVL
GKAEDAAKYKERRQRLNELIQKTFYDPEKKQYATGSQIDRIYPMLVGVTDEQHMPEVKEGLYRETLENCKGHIGSGLVGV
TILTDWAIKDGEADFLYSMLKKRELPGYLYMIDQGASTTWEYWSGERSKVHNCFNGIGAWFCQAVGGILPDEDEPGYKHF
FIKPQIPNGVTWARAARETPYGTARVSWTMENRSLSLDLEIPANSMATFIAPFNVSNCVLDGNNVEISAGSILLESGKHT
LSLPAE

Sequences:

>Translated_886_residues
MKCISIYFVTLLLLMSGCESGRRFILKDLRCENLENPVAIDNTHPHFSWKIETDGQTMRQAYFEIQVATDSSLLAQGKAD
LWNSGKVESSASVMVPYRGKELRSSVLAYWKVRVWDDKGESSDWSPINRFGIGLLDKAEWQGKYIGMPDEKNPMLRNKFE
LQDRDATLLLHVNSLGYHEIYLNGRKVSEDVLSPAVSQLNKRSLSVTYDLTPYAKQGINDLLLWLGRGWYRKATFNAVHD
GPLVKLQLDEIQRNGATSTLLVTDSSWEGRGSMYGETGTGTWYPHQFGGECVDGRKALPDLTTATLDKLDWTPVLEVEVP
GIEVSPQMCEPNRIQEIIRPKGIKQIGDSIWLVDMGKALNGWVELSFPKLPEGHRVRMEYTDWLNENEDFKPQEENGQYE
DWYIGSGQGKEVFRNKFNHHAFQYIRISGLAKAPEEVTGYLIHTDYKDASSFECSDPDLNAIYAMIKYTFKNLAFSGYIV
DCPHYERMGYGGDGNASCKSFQTLYEGSSVYMNWMQMWQDCIREDGGMPHCVPSPYPAGGGPYWCGFIITGSWQTYLNYG
DSRLIERYYPVMRHWLRYVDAYTVDGLLKRWPDTDYRAWYLGDWLAPAGVDYTAQSSVDLVSNCFISDCLTTMEKIAKVL
GKAEDAAKYKERRQRLNELIQKTFYDPEKKQYATGSQIDRIYPMLVGVTDEQHMPEVKEGLYRETLENCKGHIGSGLVGV
TILTDWAIKDGEADFLYSMLKKRELPGYLYMIDQGASTTWEYWSGERSKVHNCFNGIGAWFCQAVGGILPDEDEPGYKHF
FIKPQIPNGVTWARAARETPYGTARVSWTMENRSLSLDLEIPANSMATFIAPFNVSNCVLDGNNVEISAGSILLESGKHT
LSLPAE
>Mature_886_residues
MKCISIYFVTLLLLMSGCESGRRFILKDLRCENLENPVAIDNTHPHFSWKIETDGQTMRQAYFEIQVATDSSLLAQGKAD
LWNSGKVESSASVMVPYRGKELRSSVLAYWKVRVWDDKGESSDWSPINRFGIGLLDKAEWQGKYIGMPDEKNPMLRNKFE
LQDRDATLLLHVNSLGYHEIYLNGRKVSEDVLSPAVSQLNKRSLSVTYDLTPYAKQGINDLLLWLGRGWYRKATFNAVHD
GPLVKLQLDEIQRNGATSTLLVTDSSWEGRGSMYGETGTGTWYPHQFGGECVDGRKALPDLTTATLDKLDWTPVLEVEVP
GIEVSPQMCEPNRIQEIIRPKGIKQIGDSIWLVDMGKALNGWVELSFPKLPEGHRVRMEYTDWLNENEDFKPQEENGQYE
DWYIGSGQGKEVFRNKFNHHAFQYIRISGLAKAPEEVTGYLIHTDYKDASSFECSDPDLNAIYAMIKYTFKNLAFSGYIV
DCPHYERMGYGGDGNASCKSFQTLYEGSSVYMNWMQMWQDCIREDGGMPHCVPSPYPAGGGPYWCGFIITGSWQTYLNYG
DSRLIERYYPVMRHWLRYVDAYTVDGLLKRWPDTDYRAWYLGDWLAPAGVDYTAQSSVDLVSNCFISDCLTTMEKIAKVL
GKAEDAAKYKERRQRLNELIQKTFYDPEKKQYATGSQIDRIYPMLVGVTDEQHMPEVKEGLYRETLENCKGHIGSGLVGV
TILTDWAIKDGEADFLYSMLKKRELPGYLYMIDQGASTTWEYWSGERSKVHNCFNGIGAWFCQAVGGILPDEDEPGYKHF
FIKPQIPNGVTWARAARETPYGTARVSWTMENRSLSLDLEIPANSMATFIAPFNVSNCVLDGNNVEISAGSILLESGKHT
LSLPAE

Specific function: Unknown

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 100575; Mature: 100575

Theoretical pI: Translated: 5.16; Mature: 5.16

Prosite motif: PS00013 PROKAR_LIPOPROTEIN

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.9 %Cys     (Translated Protein)
2.7 %Met     (Translated Protein)
4.6 %Cys+Met (Translated Protein)
1.9 %Cys     (Mature Protein)
2.7 %Met     (Mature Protein)
4.6 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKCISIYFVTLLLLMSGCESGRRFILKDLRCENLENPVAIDNTHPHFSWKIETDGQTMRQ
CCHHHHHHHHHHHHHHCCCCCCHHHHHHHHHCCCCCCEEECCCCCCEEEEEECCCHHHEE
AYFEIQVATDSSLLAQGKADLWNSGKVESSASVMVPYRGKELRSSVLAYWKVRVWDDKGE
EEEEEEEECCCHHHHCCCCCCCCCCCCCCCCEEEECCCCHHHHHHHEEEEEEEEECCCCC
SSDWSPINRFGIGLLDKAEWQGKYIGMPDEKNPMLRNKFELQDRDATLLLHVNSLGYHEI
CCCCCCHHHHCCCCCCCCCCCCCEECCCCCCCCCCCCCCCCCCCCEEEEEEECCCCEEEE
YLNGRKVSEDVLSPAVSQLNKRSLSVTYDLTPYAKQGINDLLLWLGRGWYRKATFNAVHD
EECCCCCHHHHHHHHHHHHCCCCEEEEEECCHHHHHCHHHHHHHHCCCCEEECCCCEECC
GPLVKLQLDEIQRNGATSTLLVTDSSWEGRGSMYGETGTGTWYPHQFGGECVDGRKALPD
CCEEEEEHHHHHCCCCCEEEEEECCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC
LTTATLDKLDWTPVLEVEVPGIEVSPQMCEPNRIQEIIRPKGIKQIGDSIWLVDMGKALN
HHHHHHHCCCCCEEEEEECCCEECCCCCCCCHHHHHHHCCCCHHHHCCCEEEEECCCCCC
GWVELSFPKLPEGHRVRMEYTDWLNENEDFKPQEENGQYEDWYIGSGQGKEVFRNKFNHH
CEEEEECCCCCCCCEEEEEEHHCCCCCCCCCCCCCCCCCCCEEEECCCCHHHHHHHHCCH
AFQYIRISGLAKAPEEVTGYLIHTDYKDASSFECSDPDLNAIYAMIKYTFKNLAFSGYIV
HEEEEEEECCCCCCHHHEEEEEEECCCCCCCCCCCCCCHHHHHHHHHHHHHHHEECCEEE
DCPHYERMGYGGDGNASCKSFQTLYEGSSVYMNWMQMWQDCIREDGGMPHCVPSPYPAGG
ECCCHHHCCCCCCCCCCHHHHHHHHCCCHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCC
GPYWCGFIITGSWQTYLNYGDSRLIERYYPVMRHWLRYVDAYTVDGLLKRWPDTDYRAWY
CCEEEEEEEECCHHEEHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCEEEE
LGDWLAPAGVDYTAQSSVDLVSNCFISDCLTTMEKIAKVLGKAEDAAKYKERRQRLNELI
EECCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHH
QKTFYDPEKKQYATGSQIDRIYPMLVGVTDEQHMPEVKEGLYRETLENCKGHIGSGLVGV
HHHCCCCCHHHCCCCCHHHHHHHHEEECCCHHCCCHHHHHHHHHHHHHHHHCCCCCEEEE
TILTDWAIKDGEADFLYSMLKKRELPGYLYMIDQGASTTWEYWSGERSKVHNCFNGIGAW
EEEEECCCCCCCHHHHHHHHHHCCCCCEEEEEECCCCCCHHHCCCCHHHHHHHHHHHHHH
FCQAVGGILPDEDEPGYKHFFIKPQIPNGVTWARAARETPYGTARVSWTMENRSLSLDLE
HHHHHCCCCCCCCCCCCEEEEEECCCCCCCHHHHHHCCCCCCCEEEEEEEECCEEEEEEE
IPANSMATFIAPFNVSNCVLDGNNVEISAGSILLESGKHTLSLPAE
CCCCCCEEEEECCCCCEEEECCCCEEEECCEEEEECCCCEEECCCC
>Mature Secondary Structure
MKCISIYFVTLLLLMSGCESGRRFILKDLRCENLENPVAIDNTHPHFSWKIETDGQTMRQ
CCHHHHHHHHHHHHHHCCCCCCHHHHHHHHHCCCCCCEEECCCCCCEEEEEECCCHHHEE
AYFEIQVATDSSLLAQGKADLWNSGKVESSASVMVPYRGKELRSSVLAYWKVRVWDDKGE
EEEEEEEECCCHHHHCCCCCCCCCCCCCCCCEEEECCCCHHHHHHHEEEEEEEEECCCCC
SSDWSPINRFGIGLLDKAEWQGKYIGMPDEKNPMLRNKFELQDRDATLLLHVNSLGYHEI
CCCCCCHHHHCCCCCCCCCCCCCEECCCCCCCCCCCCCCCCCCCCEEEEEEECCCCEEEE
YLNGRKVSEDVLSPAVSQLNKRSLSVTYDLTPYAKQGINDLLLWLGRGWYRKATFNAVHD
EECCCCCHHHHHHHHHHHHCCCCEEEEEECCHHHHHCHHHHHHHHCCCCEEECCCCEECC
GPLVKLQLDEIQRNGATSTLLVTDSSWEGRGSMYGETGTGTWYPHQFGGECVDGRKALPD
CCEEEEEHHHHHCCCCCEEEEEECCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC
LTTATLDKLDWTPVLEVEVPGIEVSPQMCEPNRIQEIIRPKGIKQIGDSIWLVDMGKALN
HHHHHHHCCCCCEEEEEECCCEECCCCCCCCHHHHHHHCCCCHHHHCCCEEEEECCCCCC
GWVELSFPKLPEGHRVRMEYTDWLNENEDFKPQEENGQYEDWYIGSGQGKEVFRNKFNHH
CEEEEECCCCCCCCEEEEEEHHCCCCCCCCCCCCCCCCCCCEEEECCCCHHHHHHHHCCH
AFQYIRISGLAKAPEEVTGYLIHTDYKDASSFECSDPDLNAIYAMIKYTFKNLAFSGYIV
HEEEEEEECCCCCCHHHEEEEEEECCCCCCCCCCCCCCHHHHHHHHHHHHHHHEECCEEE
DCPHYERMGYGGDGNASCKSFQTLYEGSSVYMNWMQMWQDCIREDGGMPHCVPSPYPAGG
ECCCHHHCCCCCCCCCCHHHHHHHHCCCHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCC
GPYWCGFIITGSWQTYLNYGDSRLIERYYPVMRHWLRYVDAYTVDGLLKRWPDTDYRAWY
CCEEEEEEEECCHHEEHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCEEEE
LGDWLAPAGVDYTAQSSVDLVSNCFISDCLTTMEKIAKVLGKAEDAAKYKERRQRLNELI
EECCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHH
QKTFYDPEKKQYATGSQIDRIYPMLVGVTDEQHMPEVKEGLYRETLENCKGHIGSGLVGV
HHHCCCCCHHHCCCCCHHHHHHHHEEECCCHHCCCHHHHHHHHHHHHHHHHCCCCCEEEE
TILTDWAIKDGEADFLYSMLKKRELPGYLYMIDQGASTTWEYWSGERSKVHNCFNGIGAW
EEEEECCCCCCCHHHHHHHHHHCCCCCEEEEEECCCCCCHHHCCCCHHHHHHHHHHHHHH
FCQAVGGILPDEDEPGYKHFFIKPQIPNGVTWARAARETPYGTARVSWTMENRSLSLDLE
HHHHHCCCCCCCCCCCCEEEEEECCCCCCCHHHHHHCCCCCCCEEEEEEEECCEEEEEEE
IPANSMATFIAPFNVSNCVLDGNNVEISAGSILLESGKHTLSLPAE
CCCCCCEEEEECCCCCEEEECCCCEEEECCEEEEECCCCEEECCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA