Definition Mycobacterium bovis BCG str. Pasteur 1173P2, complete genome.
Accession NC_008769
Length 4,374,522

Click here to switch to the map view.

The map label for this gene is PPE2

Identifier: 121636169

GI number: 121636169

Start: 335908

End: 337578

Strand: Reverse

Name: PPE2

Synonym: BCG_0294c

Alternate gene names: 121636169

Gene position: 337578-335908 (Counterclockwise)

Preceding gene: 121636171

Following gene: 121636168

Centisome position: 7.72

GC content: 67.09

Gene sequence:

>1671_bases
ATGACCGCCCCGATCTGGATGGCTTCGCCCCCAGAGGTGCACTCGGCGCTGCTAAGCAGCGGGCCTGGGCCCGGTCCGCT
GCTGGTGTCGGCCGAGGGGTGGCACTCGTTGAGCATCGCCTACGCGGAGACGGCCGACGAGCTGGCCGCGCTGTTGGCCG
CCGTACAGGCCGGCACCTGGGACGGCCCGACCGCCGCGGTTTACGTGGCCGCCCATACCCCTTATCTGGCGTGGCTGGTG
CAGGCCAGCGCTAACAGCGCGGCCATGGCCACCCGGCAAGAAACCGCGGCCACCGCCTACGGCACCGCCTTGGCCGCGAT
GCCAACGTTGGCCGAGCTGGGCGCCAACCACGCCCTCCACGGCGTGCTGATGGCGACGAACTTCTTCGGCATCAACACCA
TCCCGATCGCGCTCAACGAGTCCGACTACGCGCGGATGTGGATCCAGGCCGCCACCACGATGGCCAGCTATCAAGCGGTC
TCGACCGCGGCGGTGGCCGCCGCACCGCAGACCACCCCAGCCCCCCAGATCGTGAAAGCCAACGCGCCGACAGCGGCTTC
CGACGAGCCGAACCAAGTCCAGGAATGGCTGCAATGGTTGCAGAAGATCGGGTATACCGACTTCTACAACAACGTTATAC
AACCGTTCATCAACTGGCTGACCAACCTCCCCTTTTTGCAAGCGATGTTTTCCGGATTTGATCCGTGGCTGCCCTCGCTG
GGTAATCCGCTAACCTTCCTAAGCCCGGCCAACATTGCGTTCGCCCTTGGCTACCCCATGGACATCGGATCTTATGTCGC
CTTCCTGTCGCAAACCTTCGCATTCATCGGGGCGGATCTGGCGGCGGCGTTCGCGTCGGGCAATCCCGCAACTATCGCTT
TTACCCTGATGTTCACCACGGTCGAAGCCATTGGCACGATCATCACCGATACCATCGCGCTGGTTAAAACGCTGCTCGAG
CAAACTCTTGCGTTGCTCCCGGCGGCGCTGCCCCTGCTAGCCGCCCCGCTGGCGCCGTTGACCCTTGCCCCTGCGAGTGC
AGCAGGCGGCTTCGCGGGCTTGTCTGGGCTGGCGGGCCTGGTTGGCATCCCGCCATCCGCGCCGCCCGTCATCCCGCCGG
TCGCGGCGATTGCCCCGAGTATCCCGACCCCCACCCCAACTCCAGCCCCAGCCCCGGCCCCCACGGCCGTGACCGCGCCG
ACGCCCCCGCCCGGGCCGCCACCGCCGCCGGTGACCGCCCCGCCGCCGGTGACCGGAGCCGGCATACAAAGCTTCGGGTA
CCTGGTGGGTGACCTGAACTCGGCGGCGCAGGCCAGGAAGGCCGTCGGCACCGGCGTTCGAAAGAAGACGCCGGAACCCG
ACAGCGCCGAGGCCCCAGCGGCCGCGGCGGCGCCCGAGGAACAGGTTCAACCGCAGCGGCGTCGGCGGCCAAAGATCAAA
CAGCTCGGCCGCGGTTACGAATACCTGGATTTAGACCCCGAAACCGGCCACGACCCGACGGGTTCGCCTCAAGGAGCGGG
AACCCTGGGTTTCGCCGGAACAACCCACAAGGCCAGTCCCGGACAAGTCGCAGGACTGATCACGTTACCCAACGACGCGT
TCGGCGGCAGCCCACGCACGCCAATGATGCCCGGAACCTGGGACACCGACTCAGCGACCCGGGTGGAGTGA

Upstream 100 bases:

>100_bases
CGCTCCAAACCTTGTCTAGCGGTCGGGCCACCACCACGCTGCTGGGCCTTAACGTGGCTGCTCGCGACGCGACGACACCT
CCGCCGGCGGTCAGCCGCCG

Downstream 100 bases:

>100_bases
GAAACCTTCGGGAGACGGATGTCGGGTCTGCTGGTCGCGGGTACGACAAGCGACGCCGGTAAGAGCGCCGTGACCGCGGG
GCTGTGCCGCGCGTTGGCCC

Product: PPE family protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 556; Mature: 555

Protein sequence:

>556_residues
MTAPIWMASPPEVHSALLSSGPGPGPLLVSAEGWHSLSIAYAETADELAALLAAVQAGTWDGPTAAVYVAAHTPYLAWLV
QASANSAAMATRQETAATAYGTALAAMPTLAELGANHALHGVLMATNFFGINTIPIALNESDYARMWIQAATTMASYQAV
STAAVAAAPQTTPAPQIVKANAPTAASDEPNQVQEWLQWLQKIGYTDFYNNVIQPFINWLTNLPFLQAMFSGFDPWLPSL
GNPLTFLSPANIAFALGYPMDIGSYVAFLSQTFAFIGADLAAAFASGNPATIAFTLMFTTVEAIGTIITDTIALVKTLLE
QTLALLPAALPLLAAPLAPLTLAPASAAGGFAGLSGLAGLVGIPPSAPPVIPPVAAIAPSIPTPTPTPAPAPAPTAVTAP
TPPPGPPPPPVTAPPPVTGAGIQSFGYLVGDLNSAAQARKAVGTGVRKKTPEPDSAEAPAAAAAPEEQVQPQRRRRPKIK
QLGRGYEYLDLDPETGHDPTGSPQGAGTLGFAGTTHKASPGQVAGLITLPNDAFGGSPRTPMMPGTWDTDSATRVE

Sequences:

>Translated_556_residues
MTAPIWMASPPEVHSALLSSGPGPGPLLVSAEGWHSLSIAYAETADELAALLAAVQAGTWDGPTAAVYVAAHTPYLAWLV
QASANSAAMATRQETAATAYGTALAAMPTLAELGANHALHGVLMATNFFGINTIPIALNESDYARMWIQAATTMASYQAV
STAAVAAAPQTTPAPQIVKANAPTAASDEPNQVQEWLQWLQKIGYTDFYNNVIQPFINWLTNLPFLQAMFSGFDPWLPSL
GNPLTFLSPANIAFALGYPMDIGSYVAFLSQTFAFIGADLAAAFASGNPATIAFTLMFTTVEAIGTIITDTIALVKTLLE
QTLALLPAALPLLAAPLAPLTLAPASAAGGFAGLSGLAGLVGIPPSAPPVIPPVAAIAPSIPTPTPTPAPAPAPTAVTAP
TPPPGPPPPPVTAPPPVTGAGIQSFGYLVGDLNSAAQARKAVGTGVRKKTPEPDSAEAPAAAAAPEEQVQPQRRRRPKIK
QLGRGYEYLDLDPETGHDPTGSPQGAGTLGFAGTTHKASPGQVAGLITLPNDAFGGSPRTPMMPGTWDTDSATRVE
>Mature_555_residues
TAPIWMASPPEVHSALLSSGPGPGPLLVSAEGWHSLSIAYAETADELAALLAAVQAGTWDGPTAAVYVAAHTPYLAWLVQ
ASANSAAMATRQETAATAYGTALAAMPTLAELGANHALHGVLMATNFFGINTIPIALNESDYARMWIQAATTMASYQAVS
TAAVAAAPQTTPAPQIVKANAPTAASDEPNQVQEWLQWLQKIGYTDFYNNVIQPFINWLTNLPFLQAMFSGFDPWLPSLG
NPLTFLSPANIAFALGYPMDIGSYVAFLSQTFAFIGADLAAAFASGNPATIAFTLMFTTVEAIGTIITDTIALVKTLLEQ
TLALLPAALPLLAAPLAPLTLAPASAAGGFAGLSGLAGLVGIPPSAPPVIPPVAAIAPSIPTPTPTPAPAPAPTAVTAPT
PPPGPPPPPVTAPPPVTGAGIQSFGYLVGDLNSAAQARKAVGTGVRKKTPEPDSAEAPAAAAAPEEQVQPQRRRRPKIKQ
LGRGYEYLDLDPETGHDPTGSPQGAGTLGFAGTTHKASPGQVAGLITLPNDAFGGSPRTPMMPGTWDTDSATRVE

Specific function: Unknown

COG id: COG5651

COG function: function code N; PPE-repeat proteins

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Belongs to the mycobacterial PPE family

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): PPE02_MYCTU (Q79FZ4)

Other databases:

- EMBL:   BX842572
- EMBL:   AE000516
- PIR:   D70940
- RefSeq:   NP_334673.1
- RefSeq:   YP_177704.1
- ProteinModelPortal:   Q79FZ4
- SMR:   Q79FZ4
- EnsemblBacteria:   EBMYCT00000000853
- EnsemblBacteria:   EBMYCT00000069416
- GeneID:   886684
- GeneID:   923184
- GenomeReviews:   AE000516_GR
- GenomeReviews:   AL123456_GR
- KEGG:   mtc:MT0269
- KEGG:   mtu:Rv0256c
- TIGR:   MT0269
- TubercuList:   Rv0256c
- GeneTree:   EBGT00050000014875
- HOGENOM:   HBG572308
- OMA:   THASAWH
- ProtClustDB:   CLSK799385
- InterPro:   IPR000030

Pfam domain/function: PF00823 PPE

EC number: NA

Molecular weight: Translated: 56952; Mature: 56821

Theoretical pI: Translated: 4.54; Mature: 4.54

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.0 %Cys     (Translated Protein)
2.2 %Met     (Translated Protein)
2.2 %Cys+Met (Translated Protein)
0.0 %Cys     (Mature Protein)
2.0 %Met     (Mature Protein)
2.0 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MTAPIWMASPPEVHSALLSSGPGPGPLLVSAEGWHSLSIAYAETADELAALLAAVQAGTW
CCCCCCCCCCHHHHHHHHHCCCCCCCEEEECCCCCEEEEEHHHHHHHHHHHHHHHHCCCC
DGPTAAVYVAAHTPYLAWLVQASANSAAMATRQETAATAYGTALAAMPTLAELGANHALH
CCCCEEEEEEECCCCEEHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHH
GVLMATNFFGINTIPIALNESDYARMWIQAATTMASYQAVSTAAVAAAPQTTPAPQIVKA
HHHHHHHCCCCEEEEEEECCCHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCEEEC
NAPTAASDEPNQVQEWLQWLQKIGYTDFYNNVIQPFINWLTNLPFLQAMFSGFDPWLPSL
CCCCCCCCCHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHCCHHHHHHHCCCCCCHHHC
GNPLTFLSPANIAFALGYPMDIGSYVAFLSQTFAFIGADLAAAFASGNPATIAFTLMFTT
CCCEEEECCCCEEEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCCEEEEHHHHHH
VEAIGTIITDTIALVKTLLEQTLALLPAALPLLAAPLAPLTLAPASAAGGFAGLSGLAGL
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCEECCCCCCCCHHHHHHHHHH
VGIPPSAPPVIPPVAAIAPSIPTPTPTPAPAPAPTAVTAPTPPPGPPPPPVTAPPPVTGA
HCCCCCCCCCCCCHHHHCCCCCCCCCCCCCCCCCCEEECCCCCCCCCCCCCCCCCCCCCC
GIQSFGYLVGDLNSAAQARKAVGTGVRKKTPEPDSAEAPAAAAAPEEQVQPQRRRRPKIK
CHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCHHHCCHHHHCCCHHH
QLGRGYEYLDLDPETGHDPTGSPQGAGTLGFAGTTHKASPGQVAGLITLPNDAFGGSPRT
HHCCCCCEEECCCCCCCCCCCCCCCCCEECCCCCCCCCCCCCEEEEEECCCCCCCCCCCC
PMMPGTWDTDSATRVE
CCCCCCCCCCCCCCCC
>Mature Secondary Structure 
TAPIWMASPPEVHSALLSSGPGPGPLLVSAEGWHSLSIAYAETADELAALLAAVQAGTW
CCCCCCCCCHHHHHHHHHCCCCCCCEEEECCCCCEEEEEHHHHHHHHHHHHHHHHCCCC
DGPTAAVYVAAHTPYLAWLVQASANSAAMATRQETAATAYGTALAAMPTLAELGANHALH
CCCCEEEEEEECCCCEEHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHH
GVLMATNFFGINTIPIALNESDYARMWIQAATTMASYQAVSTAAVAAAPQTTPAPQIVKA
HHHHHHHCCCCEEEEEEECCCHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCEEEC
NAPTAASDEPNQVQEWLQWLQKIGYTDFYNNVIQPFINWLTNLPFLQAMFSGFDPWLPSL
CCCCCCCCCHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHCCHHHHHHHCCCCCCHHHC
GNPLTFLSPANIAFALGYPMDIGSYVAFLSQTFAFIGADLAAAFASGNPATIAFTLMFTT
CCCEEEECCCCEEEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCCEEEEHHHHHH
VEAIGTIITDTIALVKTLLEQTLALLPAALPLLAAPLAPLTLAPASAAGGFAGLSGLAGL
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCEECCCCCCCCHHHHHHHHHH
VGIPPSAPPVIPPVAAIAPSIPTPTPTPAPAPAPTAVTAPTPPPGPPPPPVTAPPPVTGA
HCCCCCCCCCCCCHHHHCCCCCCCCCCCCCCCCCCEEECCCCCCCCCCCCCCCCCCCCCC
GIQSFGYLVGDLNSAAQARKAVGTGVRKKTPEPDSAEAPAAAAAPEEQVQPQRRRRPKIK
CHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCHHHCCHHHHCCCHHH
QLGRGYEYLDLDPETGHDPTGSPQGAGTLGFAGTTHKASPGQVAGLITLPNDAFGGSPRT
HHCCCCCEEECCCCCCCCCCCCCCCCCEECCCCCCCCCCCCCEEEEEECCCCCCCCCCCC
PMMPGTWDTDSATRVE
CCCCCCCCCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 9634230; 12218036