Definition Bacteroides thetaiotaomicron VPI-5482 chromosome, complete genome.
Accession NC_004663
Length 6,260,361

Click here to switch to the map view.

The map label for this gene is yuxL [H]

Identifier: 29345997

GI number: 29345997

Start: 724150

End: 726249

Strand: Reverse

Name: yuxL [H]

Synonym: BT_0587

Alternate gene names: 29345997

Gene position: 726249-724150 (Counterclockwise)

Preceding gene: 29345998

Following gene: 29345991

Centisome position: 11.6

GC content: 46.67

Gene sequence:

>2100_bases
ATGAGACAAGCAAATCTATTTATGATGTCGGCAGCAATGTTGTTAGCTGCCTGCGGCGGAACAAAAGACGCGGGCAAAAC
GGATCAGGTGCTTATCGAAAAATCCGATATTAAGATCGAAGGGAAGCGTATGACGCCTGAAGCCCTTTGGGCAATGGGAC
GTATCGGAGGACTGGCGGTATCGCCCGACGGAAAGAAAATTGCGTATACGGTAGCATACTACAGTGTACCGGAGAACAAG
AGTAATCGCGAAGTTTTCGTCATGAACGCGGACGGCAGCGATAACCGACAAATCACCCGCACTCCTTATCAGGAGAATGA
GGTGACCTGGATAAAAGGAGGATCGAAGCTGGCTTTCCTGAGCAACGACAACGGAAGCAGCCAACTATATGAAATGAATC
CGGACGGTAGCGGCCGTAAACAACTGACCAACTACGATGGTGACATCGAGGGTTATTCTATCTCACCGGACGGCAAGAAA
CTGCTGTTCATCTCGCAAGTGAAAACCAAAGAAAGCACTGCCGATAAATATCCGGATCTGCCGAAAGCTACAGGTATTAT
TGTCACCGACCTGATGTATAAGCACTGGGATGAATGGGTGACAACTGCTCCGCATCCTTTCGTGGCAGACTTTGACGGTA
ACGGTATTTCCAATATCGTGGATATACTGGAAGGAGAACCATACGAAAGTCCGATGAAACCTTGGGGCGGCATTGAGCAG
CTGGCTTGGAATACGACTTCGGACAAAGTGGCTTATACCTGTCGCAAGAAAACAGGGCTGGAATATGCTGTTTCTACCAA
TTCGGATATTTATGTGTATGATCTGAATACAAAGAAAACGGATAATATCACCGAAGAAAACAAGGGGTATGACACCAATC
CGCAATACTCTCCGGATGGCAAGTACATTGCATGGCAAAGCATGGAGCGCGATGGATACGAAGCTGATCTGAACCGTTTG
TTTATCATGAATCTGGAAACTGGAGAGAAGCGTTTTGTCAGCAAAGCATTTGAGTCTAATGTGGATGCGTTTGTCTGGGG
CAACGATGCCAAGACCATCTATTTTACAGGTGTATGGCATGGAGAAACTCAGATTTATTCTCTTGACCTGACGAATGATT
CTGTAAAGGCGATTACTTCGGGTATGTATGATTATGAAGGGGTAGCACTCTTCGGTGACAAACTGATTGCCAAACGCCAC
TCAATGAGTATGGGTGATGAGATCTATGCGGTAGCATTGGATGGTTCTGCCACTCAACTGACACAGGAGAACAAGGAGAT
TTATGATCAGCTGGAAATGGGTAAGGTAGAAGGTCGCTGGATGAAAACGACGGATGGCAAGGATATGTTGACATGGGTGA
TCTATCCTCCCCAGTTCGATCCGAACAAGAAATATCCGACATTGCTGTTCTGTGAAGGTGGTCCTCAAAGTCCGGTAAGT
CAGTTCTGGTCTTATCGCTGGAACTTCCAGATTATGGCTGCCAACGACTATATCATTGTAGCCCCGAACCGTCGCGGATT
ACCGGGATTCGGAGTGGAATGGAACGAACAGATCAGTGGTGATTATGGTGGTCAGTGTATGAAAGACTATTTCACTGCTA
TCGACGAGATGGCAAAAGAATCGTATGTAGATAAAGATCGTCTGGGATGTGTGGGCGCTAGTTTCGGAGGATTCTCCGTA
TATTGGTTAGCCGGTCATCACGACAAACGTTTCAAGGCATTTATCGCTCATGACGGAATCTTCAATATGGAAATGCAGTA
TCTGGAAACAGAAGAGAAATGGTTTGCCAACTGGGATATGGGCGGCGCGTACTGGGAAAAACAGAATCCGATAGCACAAC
GTACTTTCGCCAACTCCCCTCACCTCTTCGTGGAAAAATGGGATACTCCGATTCTCTGTATTCATGGAGAAAAAGATTTC
CGTATTTTGGCTAATCAGGCTATGGCTGCATTTGATGCCGCTGTAATGCGTGGTGTACCTGCAGAGTTGCTAATTTATCC
GGATGAGAACCACTGGGTACTGAAACCGCAGAATGGTGTCTTGTGGCAACGCACTTTCTTTGAGTGGCTGGATAAGTGGC
TGAAGGCTCCTGCAAAATAA

Upstream 100 bases:

>100_bases
TCTTCTGCTACTGGTATATGAAGAAAGGAAACTGGCAGAAAAAGCAGATTTAAATCCTTTTTTCATTATCTTCGCAAGAA
AATAAACATTTTTATAAAAT

Downstream 100 bases:

>100_bases
ATCTTTGATATAAGACAAATAATGAAGGCTCTGTTCTCAAATCAAATTGAGTTCAGAGCCTTCTGCATTACATCTAAAAT
CCGCTAGACTTTACTCATGA

Product: prolyl oligopeptidase family protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 699; Mature: 699

Protein sequence:

>699_residues
MRQANLFMMSAAMLLAACGGTKDAGKTDQVLIEKSDIKIEGKRMTPEALWAMGRIGGLAVSPDGKKIAYTVAYYSVPENK
SNREVFVMNADGSDNRQITRTPYQENEVTWIKGGSKLAFLSNDNGSSQLYEMNPDGSGRKQLTNYDGDIEGYSISPDGKK
LLFISQVKTKESTADKYPDLPKATGIIVTDLMYKHWDEWVTTAPHPFVADFDGNGISNIVDILEGEPYESPMKPWGGIEQ
LAWNTTSDKVAYTCRKKTGLEYAVSTNSDIYVYDLNTKKTDNITEENKGYDTNPQYSPDGKYIAWQSMERDGYEADLNRL
FIMNLETGEKRFVSKAFESNVDAFVWGNDAKTIYFTGVWHGETQIYSLDLTNDSVKAITSGMYDYEGVALFGDKLIAKRH
SMSMGDEIYAVALDGSATQLTQENKEIYDQLEMGKVEGRWMKTTDGKDMLTWVIYPPQFDPNKKYPTLLFCEGGPQSPVS
QFWSYRWNFQIMAANDYIIVAPNRRGLPGFGVEWNEQISGDYGGQCMKDYFTAIDEMAKESYVDKDRLGCVGASFGGFSV
YWLAGHHDKRFKAFIAHDGIFNMEMQYLETEEKWFANWDMGGAYWEKQNPIAQRTFANSPHLFVEKWDTPILCIHGEKDF
RILANQAMAAFDAAVMRGVPAELLIYPDENHWVLKPQNGVLWQRTFFEWLDKWLKAPAK

Sequences:

>Translated_699_residues
MRQANLFMMSAAMLLAACGGTKDAGKTDQVLIEKSDIKIEGKRMTPEALWAMGRIGGLAVSPDGKKIAYTVAYYSVPENK
SNREVFVMNADGSDNRQITRTPYQENEVTWIKGGSKLAFLSNDNGSSQLYEMNPDGSGRKQLTNYDGDIEGYSISPDGKK
LLFISQVKTKESTADKYPDLPKATGIIVTDLMYKHWDEWVTTAPHPFVADFDGNGISNIVDILEGEPYESPMKPWGGIEQ
LAWNTTSDKVAYTCRKKTGLEYAVSTNSDIYVYDLNTKKTDNITEENKGYDTNPQYSPDGKYIAWQSMERDGYEADLNRL
FIMNLETGEKRFVSKAFESNVDAFVWGNDAKTIYFTGVWHGETQIYSLDLTNDSVKAITSGMYDYEGVALFGDKLIAKRH
SMSMGDEIYAVALDGSATQLTQENKEIYDQLEMGKVEGRWMKTTDGKDMLTWVIYPPQFDPNKKYPTLLFCEGGPQSPVS
QFWSYRWNFQIMAANDYIIVAPNRRGLPGFGVEWNEQISGDYGGQCMKDYFTAIDEMAKESYVDKDRLGCVGASFGGFSV
YWLAGHHDKRFKAFIAHDGIFNMEMQYLETEEKWFANWDMGGAYWEKQNPIAQRTFANSPHLFVEKWDTPILCIHGEKDF
RILANQAMAAFDAAVMRGVPAELLIYPDENHWVLKPQNGVLWQRTFFEWLDKWLKAPAK
>Mature_699_residues
MRQANLFMMSAAMLLAACGGTKDAGKTDQVLIEKSDIKIEGKRMTPEALWAMGRIGGLAVSPDGKKIAYTVAYYSVPENK
SNREVFVMNADGSDNRQITRTPYQENEVTWIKGGSKLAFLSNDNGSSQLYEMNPDGSGRKQLTNYDGDIEGYSISPDGKK
LLFISQVKTKESTADKYPDLPKATGIIVTDLMYKHWDEWVTTAPHPFVADFDGNGISNIVDILEGEPYESPMKPWGGIEQ
LAWNTTSDKVAYTCRKKTGLEYAVSTNSDIYVYDLNTKKTDNITEENKGYDTNPQYSPDGKYIAWQSMERDGYEADLNRL
FIMNLETGEKRFVSKAFESNVDAFVWGNDAKTIYFTGVWHGETQIYSLDLTNDSVKAITSGMYDYEGVALFGDKLIAKRH
SMSMGDEIYAVALDGSATQLTQENKEIYDQLEMGKVEGRWMKTTDGKDMLTWVIYPPQFDPNKKYPTLLFCEGGPQSPVS
QFWSYRWNFQIMAANDYIIVAPNRRGLPGFGVEWNEQISGDYGGQCMKDYFTAIDEMAKESYVDKDRLGCVGASFGGFSV
YWLAGHHDKRFKAFIAHDGIFNMEMQYLETEEKWFANWDMGGAYWEKQNPIAQRTFANSPHLFVEKWDTPILCIHGEKDF
RILANQAMAAFDAAVMRGVPAELLIYPDENHWVLKPQNGVLWQRTFFEWLDKWLKAPAK

Specific function: Involved In The Tonb-Independent Uptake Of Group A Colicins (Colicins A, E1, E2, E3 And K). Necessary For The Colicins To Reach Their Respective Targets After Initial Binding To The Bacteria. [C]

COG id: COG1506

COG function: function code E; Dipeptidyl aminopeptidases/acylaminoacyl-peptidases

Gene ontology:

Cell location: Periplasmic Protein [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the peptidase S9B family [H]

Homologues:

Organism=Homo sapiens, GI23510451, Length=471, Percent_Identity=19.9575371549894, Blast_Score=94, Evalue=5e-19,
Organism=Caenorhabditis elegans, GI25149159, Length=460, Percent_Identity=24.1304347826087, Blast_Score=106, Evalue=4e-23,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR011042
- InterPro:   IPR011659
- InterPro:   IPR001375 [H]

Pfam domain/function: PF07676 PD40; PF00326 Peptidase_S9 [H]

EC number: NA

Molecular weight: Translated: 79241; Mature: 79241

Theoretical pI: Translated: 4.77; Mature: 4.77

Prosite motif: PS00013 PROKAR_LIPOPROTEIN

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.9 %Cys     (Translated Protein)
3.7 %Met     (Translated Protein)
4.6 %Cys+Met (Translated Protein)
0.9 %Cys     (Mature Protein)
3.7 %Met     (Mature Protein)
4.6 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MRQANLFMMSAAMLLAACGGTKDAGKTDQVLIEKSDIKIEGKRMTPEALWAMGRIGGLAV
CCCCHHHHHHHHHHHHHCCCCCCCCCCCEEEEEECCEEEECCCCCHHHHHHHHCCCCEEE
SPDGKKIAYTVAYYSVPENKSNREVFVMNADGSDNRQITRTPYQENEVTWIKGGSKLAFL
CCCCCEEEEEEEEEECCCCCCCCEEEEEECCCCCCCEEEECCCCCCCEEEEECCCEEEEE
SNDNGSSQLYEMNPDGSGRKQLTNYDGDIEGYSISPDGKKLLFISQVKTKESTADKYPDL
ECCCCCCEEEEECCCCCCCCCCCCCCCCCCCEEECCCCCEEEEEEECCCCCCHHHCCCCC
PKATGIIVTDLMYKHWDEWVTTAPHPFVADFDGNGISNIVDILEGEPYESPMKPWGGIEQ
CCCCCEEEHHHHHHHHHHHHHCCCCCEEEECCCCCHHHHHHHHCCCCCCCCCCCCCCHHH
LAWNTTSDKVAYTCRKKTGLEYAVSTNSDIYVYDLNTKKTDNITEENKGYDTNPQYSPDG
HEECCCCCCEEEEEECCCCCEEEEECCCEEEEEECCCCCCCCCCCCCCCCCCCCCCCCCC
KYIAWQSMERDGYEADLNRLFIMNLETGEKRFVSKAFESNVDAFVWGNDAKTIYFTGVWH
CEEEEECCCCCCCCCCCCEEEEEEECCCHHHHHHHHHHCCCCEEEECCCCCEEEEEEEEE
GETQIYSLDLTNDSVKAITSGMYDYEGVALFGDKLIAKRHSMSMGDEIYAVALDGSATQL
CCEEEEEEEECCCHHHHHHCCCCCCCCEEEECHHHHHHHHCCCCCCEEEEEEECCCHHHH
TQENKEIYDQLEMGKVEGRWMKTTDGKDMLTWVIYPPQFDPNKKYPTLLFCEGGPQSPVS
HHHHHHHHHHHHCCCCCCCEEEECCCCCEEEEEEECCCCCCCCCCCEEEEECCCCCCHHH
QFWSYRWNFQIMAANDYIIVAPNRRGLPGFGVEWNEQISGDYGGQCMKDYFTAIDEMAKE
HHHCEEEEEEEEEECCEEEECCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHH
SYVDKDRLGCVGASFGGFSVYWLAGHHDKRFKAFIAHDGIFNMEMQYLETEEKWFANWDM
HCCCCHHCCEEECCCCCEEEEEEECCCCCCEEEEEEECCEEEEEEEEEECCCCEEECCCC
GGAYWEKQNPIAQRTFANSPHLFVEKWDTPILCIHGEKDFRILANQAMAAFDAAVMRGVP
CCEEECCCCCHHHHHCCCCCEEEEEECCCCEEEEECCCCEEEHHHHHHHHHHHHHHCCCC
AELLIYPDENHWVLKPQNGVLWQRTFFEWLDKWLKAPAK
CEEEEEECCCCEEEECCCCEEEHHHHHHHHHHHHCCCCC
>Mature Secondary Structure
MRQANLFMMSAAMLLAACGGTKDAGKTDQVLIEKSDIKIEGKRMTPEALWAMGRIGGLAV
CCCCHHHHHHHHHHHHHCCCCCCCCCCCEEEEEECCEEEECCCCCHHHHHHHHCCCCEEE
SPDGKKIAYTVAYYSVPENKSNREVFVMNADGSDNRQITRTPYQENEVTWIKGGSKLAFL
CCCCCEEEEEEEEEECCCCCCCCEEEEEECCCCCCCEEEECCCCCCCEEEEECCCEEEEE
SNDNGSSQLYEMNPDGSGRKQLTNYDGDIEGYSISPDGKKLLFISQVKTKESTADKYPDL
ECCCCCCEEEEECCCCCCCCCCCCCCCCCCCEEECCCCCEEEEEEECCCCCCHHHCCCCC
PKATGIIVTDLMYKHWDEWVTTAPHPFVADFDGNGISNIVDILEGEPYESPMKPWGGIEQ
CCCCCEEEHHHHHHHHHHHHHCCCCCEEEECCCCCHHHHHHHHCCCCCCCCCCCCCCHHH
LAWNTTSDKVAYTCRKKTGLEYAVSTNSDIYVYDLNTKKTDNITEENKGYDTNPQYSPDG
HEECCCCCCEEEEEECCCCCEEEEECCCEEEEEECCCCCCCCCCCCCCCCCCCCCCCCCC
KYIAWQSMERDGYEADLNRLFIMNLETGEKRFVSKAFESNVDAFVWGNDAKTIYFTGVWH
CEEEEECCCCCCCCCCCCEEEEEEECCCHHHHHHHHHHCCCCEEEECCCCCEEEEEEEEE
GETQIYSLDLTNDSVKAITSGMYDYEGVALFGDKLIAKRHSMSMGDEIYAVALDGSATQL
CCEEEEEEEECCCHHHHHHCCCCCCCCEEEECHHHHHHHHCCCCCCEEEEEEECCCHHHH
TQENKEIYDQLEMGKVEGRWMKTTDGKDMLTWVIYPPQFDPNKKYPTLLFCEGGPQSPVS
HHHHHHHHHHHHCCCCCCCEEEECCCCCEEEEEEECCCCCCCCCCCEEEEECCCCCCHHH
QFWSYRWNFQIMAANDYIIVAPNRRGLPGFGVEWNEQISGDYGGQCMKDYFTAIDEMAKE
HHHCEEEEEEEEEECCEEEECCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHH
SYVDKDRLGCVGASFGGFSVYWLAGHHDKRFKAFIAHDGIFNMEMQYLETEEKWFANWDM
HCCCCHHCCEEECCCCCEEEEEEECCCCCCEEEEEEECCEEEEEEEEEECCCCEEECCCC
GGAYWEKQNPIAQRTFANSPHLFVEKWDTPILCIHGEKDFRILANQAMAAFDAAVMRGVP
CCEEECCCCCHHHHHCCCCCEEEEEECCCCEEEEECCCCEEEHHHHHHHHHHHHHHCCCC
AELLIYPDENHWVLKPQNGVLWQRTFFEWLDKWLKAPAK
CEEEEEECCCCEEEECCCCEEEHHHHHHHHHHHHCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 9384377; 3098560 [H]