| Definition | Mycobacterium tuberculosis H37Ra, complete genome. |
|---|---|
| Accession | NC_009525 |
| Length | 4,419,977 |
Click here to switch to the map view.
The map label for this gene is ppe21
Identifier: 148661344
GI number: 148661344
Start: 1752814
End: 1754850
Strand: Reverse
Name: ppe21
Synonym: MRA_1560
Alternate gene names: 148661344
Gene position: 1754850-1752814 (Counterclockwise)
Preceding gene: 148661358
Following gene: 148661338
Centisome position: 39.7
GC content: 62.1
Gene sequence:
>2037_bases ATGAATTTTTCGGTGTTGCCGCCGGAGATCAATTCGGCGCTGATGTTCGCTGGTGCCGGGCCGGGACCGATGTTGGCGGC GGCGTCGGCCTGGACCGGGCTGGCCGGCGATTTGGGTTCGGCGGCGGCCTCATTTTCGGCGGTGACCTCGCAGTTGGCCA CCGGGTCCTGGCAAGGTCCGGCGTCAGCGGCCATGACAGGCGTGGCCGCGTCCTATGCTCGCTGGCTGACCACGGCCGCA GCGCAGGCTGAGCAGGCGGCGGGTCAAGCCCAGGCGGCGGTATCGGCGTTCGAGGCGGCGCTGGCGGCGACGGTGCATCC GGGCGCGGTGAGCGCCAATCGAGGTCGGTTGCGCTCCTTGGTGGCCTCGAATCTGTTGGGGCAAAACGCCCCGGCCATCG CGGCCGTCGAGGCCGTCTATGAGCAGATGTGGGCCGCCGATGTCGCCGCGATGCTCGGTTATCACGGCGAGGCGTCGGCG GTCGCCTTGTCGCTGACGCCGTTCACACCGTCGCCGAGCGCGGCAGCCACGCCCGGCGGTGCGGTGATCATCGCGGGGTT TCCGTTTCTCGATCTGGGCAACGTCACCATCGGTGGCTTCAATCTGGCCAGCGGCAATCTGGGCCTCGGCAACCTGGGCA GCTTCAACCCGGGTAGCGCCAACACGGGCAGCGTCAACTTGGGCAACGCCAATATCGGTGATCTCAACCTGGGCAGCGGC AATATCGGCAGCTACAACCTGGGTGGCGGCAACACCGGGGATCTCAACCCGGACAGTGGAAACACGGGCACGCTCAACTG GGGTAGCGGAAACATCGGCAGCTATAACCTGGGCGGCGGCAACCTCGGCAGCTATAACCTGGGTAGTGGAAATACCGGCG ACACCAACTTTGGCGGCGGTAACACCGGAAATCTCAACGTGGGTGGCGGCAACACCGGGAACTCGAATTTCGGGTTCGGA AACACCGGTAACGTCAACTTTGGTAACGGAAACACCGGCGACACCAACTTTGGCAGCGGCAACCTTGGCAGTGGAAATAT CGGTTTCGGCAACAAGGGCTCTCATAACATCGGGTTTGGGAACAGCGGCAACAACAACATCGGCTTCGGGCTCACCGGTG ATAACCAGATAGGTTTCGGCGCCCTCAATTCAGGTAGCGGGAACCTCGGCTTCGGGAACTCGGGCAACGGTAATATCGGC TTTTTCAACTCGGGCAATAACAACATCGGCATGGGAAACTCGGGCAATGGAGTCGGGGCGCTGAGCGTGGAGTTCGGCAG TTCGGCCGAGCGCAGCTCGGGCTTCGGCAACTCCGGCGAGCTCAGTACCGGTATCGGCAACTCCGGCCAGCTCAGCACGG GCTGGTTCAACTCGGCCACCACCAGCACCGGCTGGTTCAACTCCGGCACCACCAATACCGGCTGGTTCAACTCGGGCACC ACGAACACCGGAATCGGAAACTCGGGCGGAAACCTGGTCACCGGCAGCATGGGTCTGTTTAACTCCGGCCATACCAACAC GGGTAGCTTCAATGCCGGCAGCATGAACACGGGCGATTTCAACTCGGGCAACGTGAACACCGGCTACTTCAACTCCGGCA ACATCAACACCGGCTTCTTCAACTCGGGCGATCTCAACACCGGATTGTTCAACTCGGTCAACCAGCCGGTACAGAACTCC GGCTGGCTGCACACGGGCACCAACAACTCGGGCTACGCTAACGCCGGCACCTTCAACTCGGGCTTCGATAACAACGCCCG TGACGAACACGCCGAATTTGTCACCGGTAACTCGGGCCTGGCCAACGTGGGCAACTACAACGCCGGCATCATCAACGTGG GTGACCATCTGTCGGGCTTCAGAAACTCGGTACCCACGATCACCGGTACGGCCAACATTTCGGGTTTCGTCAATGCGGGA ACCTCGATCTCTGGCTTCTTCAACTTCGGCAGCCTCATGTCGGGCTTCGCCAACTTCGACGACGAGGTCTCGGGGTATCT CAACGGGGACAGTCGGGCGTCGGGCTGGATCCATTAG
Upstream 100 bases:
>100_bases CCCGTCCGAAGCGCCCGGCTTTTTCGTAGGCTTCGCTGCGGTTGGGGCCAGACAGCGCCGTGAAGCCCGGTGGGTGTGGC CGGCTGACGGGATGGTTGTG
Downstream 100 bases:
>100_bases CGGCGCTCACGGGCGATCGTGCGGAAACCGCTGGGGGCGGTCGCCTCGCTAACTCCCCAGACATCCAGGGCCGAGCAGCT CCTTGAGGTCACCCATCAAC
Product: PPE family protein
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 678; Mature: 678
Protein sequence:
>678_residues MNFSVLPPEINSALMFAGAGPGPMLAAASAWTGLAGDLGSAAASFSAVTSQLATGSWQGPASAAMTGVAASYARWLTTAA AQAEQAAGQAQAAVSAFEAALAATVHPGAVSANRGRLRSLVASNLLGQNAPAIAAVEAVYEQMWAADVAAMLGYHGEASA VALSLTPFTPSPSAAATPGGAVIIAGFPFLDLGNVTIGGFNLASGNLGLGNLGSFNPGSANTGSVNLGNANIGDLNLGSG NIGSYNLGGGNTGDLNPDSGNTGTLNWGSGNIGSYNLGGGNLGSYNLGSGNTGDTNFGGGNTGNLNVGGGNTGNSNFGFG NTGNVNFGNGNTGDTNFGSGNLGSGNIGFGNKGSHNIGFGNSGNNNIGFGLTGDNQIGFGALNSGSGNLGFGNSGNGNIG FFNSGNNNIGMGNSGNGVGALSVEFGSSAERSSGFGNSGELSTGIGNSGQLSTGWFNSATTSTGWFNSGTTNTGWFNSGT TNTGIGNSGGNLVTGSMGLFNSGHTNTGSFNAGSMNTGDFNSGNVNTGYFNSGNINTGFFNSGDLNTGLFNSVNQPVQNS GWLHTGTNNSGYANAGTFNSGFDNNARDEHAEFVTGNSGLANVGNYNAGIINVGDHLSGFRNSVPTITGTANISGFVNAG TSISGFFNFGSLMSGFANFDDEVSGYLNGDSRASGWIH
Sequences:
>Translated_678_residues MNFSVLPPEINSALMFAGAGPGPMLAAASAWTGLAGDLGSAAASFSAVTSQLATGSWQGPASAAMTGVAASYARWLTTAA AQAEQAAGQAQAAVSAFEAALAATVHPGAVSANRGRLRSLVASNLLGQNAPAIAAVEAVYEQMWAADVAAMLGYHGEASA VALSLTPFTPSPSAAATPGGAVIIAGFPFLDLGNVTIGGFNLASGNLGLGNLGSFNPGSANTGSVNLGNANIGDLNLGSG NIGSYNLGGGNTGDLNPDSGNTGTLNWGSGNIGSYNLGGGNLGSYNLGSGNTGDTNFGGGNTGNLNVGGGNTGNSNFGFG NTGNVNFGNGNTGDTNFGSGNLGSGNIGFGNKGSHNIGFGNSGNNNIGFGLTGDNQIGFGALNSGSGNLGFGNSGNGNIG FFNSGNNNIGMGNSGNGVGALSVEFGSSAERSSGFGNSGELSTGIGNSGQLSTGWFNSATTSTGWFNSGTTNTGWFNSGT TNTGIGNSGGNLVTGSMGLFNSGHTNTGSFNAGSMNTGDFNSGNVNTGYFNSGNINTGFFNSGDLNTGLFNSVNQPVQNS GWLHTGTNNSGYANAGTFNSGFDNNARDEHAEFVTGNSGLANVGNYNAGIINVGDHLSGFRNSVPTITGTANISGFVNAG TSISGFFNFGSLMSGFANFDDEVSGYLNGDSRASGWIH >Mature_678_residues MNFSVLPPEINSALMFAGAGPGPMLAAASAWTGLAGDLGSAAASFSAVTSQLATGSWQGPASAAMTGVAASYARWLTTAA AQAEQAAGQAQAAVSAFEAALAATVHPGAVSANRGRLRSLVASNLLGQNAPAIAAVEAVYEQMWAADVAAMLGYHGEASA VALSLTPFTPSPSAAATPGGAVIIAGFPFLDLGNVTIGGFNLASGNLGLGNLGSFNPGSANTGSVNLGNANIGDLNLGSG NIGSYNLGGGNTGDLNPDSGNTGTLNWGSGNIGSYNLGGGNLGSYNLGSGNTGDTNFGGGNTGNLNVGGGNTGNSNFGFG NTGNVNFGNGNTGDTNFGSGNLGSGNIGFGNKGSHNIGFGNSGNNNIGFGLTGDNQIGFGALNSGSGNLGFGNSGNGNIG FFNSGNNNIGMGNSGNGVGALSVEFGSSAERSSGFGNSGELSTGIGNSGQLSTGWFNSATTSTGWFNSGTTNTGWFNSGT TNTGIGNSGGNLVTGSMGLFNSGHTNTGSFNAGSMNTGDFNSGNVNTGYFNSGNINTGFFNSGDLNTGLFNSVNQPVQNS GWLHTGTNNSGYANAGTFNSGFDNNARDEHAEFVTGNSGLANVGNYNAGIINVGDHLSGFRNSVPTITGTANISGFVNAG TSISGFFNFGSLMSGFANFDDEVSGYLNGDSRASGWIH
Specific function: Unknown
COG id: NA
COG function: NA
Gene ontology:
Cell location: Cell membrane; Multi-pass membrane protein (Potential)
Metaboloic importance: NA
Operon status: Not Known
Operon components: None
Similarity: Belongs to the mycobacterial PPE family
Homologues:
None
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): PPE21_MYCTU (Q10778)
Other databases:
- EMBL: BX842577 - EMBL: AE000516 - PIR: A70762 - RefSeq: NP_336052.1 - RefSeq: YP_177817.1 - ProteinModelPortal: Q10778 - SMR: Q10778 - EnsemblBacteria: EBMYCT00000002192 - EnsemblBacteria: EBMYCT00000071955 - GeneID: 886384 - GeneID: 924340 - GenomeReviews: AE000516_GR - GenomeReviews: AL123456_GR - KEGG: mtc:MT1599 - KEGG: mtu:Rv1548c - TIGR: MT1599 - TubercuList: Rv1548c - GeneTree: EBGT00050000014886 - HOGENOM: HBG572308 - OMA: STGVYFT - ProtClustDB: CLSK799815 - InterPro: IPR002989 - InterPro: IPR000030
Pfam domain/function: PF01469 Pentapeptide_2; PF00823 PPE
EC number: NA
Molecular weight: Translated: 66737; Mature: 66737
Theoretical pI: Translated: 4.15; Mature: 4.15
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
HASH(0x1e577c74)-; HASH(0x1e791b4c)-;
Cys/Met content:
0.0 %Cys (Translated Protein) 1.5 %Met (Translated Protein) 1.5 %Cys+Met (Translated Protein) 0.0 %Cys (Mature Protein) 1.5 %Met (Mature Protein) 1.5 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MNFSVLPPEINSALMFAGAGPGPMLAAASAWTGLAGDLGSAAASFSAVTSQLATGSWQGP CCCCCCCCCCCCEEEEECCCCCCHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHCCCCCCC ASAAMTGVAASYARWLTTAAAQAEQAAGQAQAAVSAFEAALAATVHPGAVSANRGRLRSL HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHEECCCCCCCCHHHHHHH VASNLLGQNAPAIAAVEAVYEQMWAADVAAMLGYHGEASAVALSLTPFTPSPSAAATPGG HHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCEEEEEEECCCCCCCCCCCCCC AVIIAGFPFLDLGNVTIGGFNLASGNLGLGNLGSFNPGSANTGSVNLGNANIGDLNLGSG EEEEECCCCEEECCEEECCEEECCCCCCCCCCCCCCCCCCCCCEEECCCCCCCCEECCCC NIGSYNLGGGNTGDLNPDSGNTGTLNWGSGNIGSYNLGGGNLGSYNLGSGNTGDTNFGGG CCCEEECCCCCCCCCCCCCCCEEEEECCCCCCCEEECCCCCCCCEECCCCCCCCCCCCCC NTGNLNVGGGNTGNSNFGFGNTGNVNFGNGNTGDTNFGSGNLGSGNIGFGNKGSHNIGFG CCCEEECCCCCCCCCCCCCCCCCCEECCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC NSGNNNIGFGLTGDNQIGFGALNSGSGNLGFGNSGNGNIGFFNSGNNNIGMGNSGNGVGA CCCCCCEEEEECCCCCCCEEEECCCCCCCCCCCCCCCCEEEEECCCCCCCCCCCCCCEEE LSVEFGSSAERSSGFGNSGELSTGIGNSGQLSTGWFNSATTSTGWFNSGTTNTGWFNSGT EEEECCCCCHHHCCCCCCCCEECCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC TNTGIGNSGGNLVTGSMGLFNSGHTNTGSFNAGSMNTGDFNSGNVNTGYFNSGNINTGFF CCCCCCCCCCCEEECCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCEECCCCCCCCEE NSGDLNTGLFNSVNQPVQNSGWLHTGTNNSGYANAGTFNSGFDNNARDEHAEFVTGNSGL CCCCCCCHHHHHCCCCHHCCCCEEECCCCCCCCCCCCCCCCCCCCCCCCCCEEEECCCCC ANVGNYNAGIINVGDHLSGFRNSVPTITGTANISGFVNAGTSISGFFNFGSLMSGFANFD CCCCCCCCCEEECCHHHHHHHHCCCEEEECCCCCEEEECCCCEEHHHHHHHHHHHHHCCC DEVSGYLNGDSRASGWIH CHHCEEECCCCCCCCCCH >Mature Secondary Structure MNFSVLPPEINSALMFAGAGPGPMLAAASAWTGLAGDLGSAAASFSAVTSQLATGSWQGP CCCCCCCCCCCCEEEEECCCCCCHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHCCCCCCC ASAAMTGVAASYARWLTTAAAQAEQAAGQAQAAVSAFEAALAATVHPGAVSANRGRLRSL HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHEECCCCCCCCHHHHHHH VASNLLGQNAPAIAAVEAVYEQMWAADVAAMLGYHGEASAVALSLTPFTPSPSAAATPGG HHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCEEEEEEECCCCCCCCCCCCCC AVIIAGFPFLDLGNVTIGGFNLASGNLGLGNLGSFNPGSANTGSVNLGNANIGDLNLGSG EEEEECCCCEEECCEEECCEEECCCCCCCCCCCCCCCCCCCCCEEECCCCCCCCEECCCC NIGSYNLGGGNTGDLNPDSGNTGTLNWGSGNIGSYNLGGGNLGSYNLGSGNTGDTNFGGG CCCEEECCCCCCCCCCCCCCCEEEEECCCCCCCEEECCCCCCCCEECCCCCCCCCCCCCC NTGNLNVGGGNTGNSNFGFGNTGNVNFGNGNTGDTNFGSGNLGSGNIGFGNKGSHNIGFG CCCEEECCCCCCCCCCCCCCCCCCEECCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC NSGNNNIGFGLTGDNQIGFGALNSGSGNLGFGNSGNGNIGFFNSGNNNIGMGNSGNGVGA CCCCCCEEEEECCCCCCCEEEECCCCCCCCCCCCCCCCEEEEECCCCCCCCCCCCCCEEE LSVEFGSSAERSSGFGNSGELSTGIGNSGQLSTGWFNSATTSTGWFNSGTTNTGWFNSGT EEEECCCCCHHHCCCCCCCCEECCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC TNTGIGNSGGNLVTGSMGLFNSGHTNTGSFNAGSMNTGDFNSGNVNTGYFNSGNINTGFF CCCCCCCCCCCEEECCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCEECCCCCCCCEE NSGDLNTGLFNSVNQPVQNSGWLHTGTNNSGYANAGTFNSGFDNNARDEHAEFVTGNSGL CCCCCCCHHHHHCCCCHHCCCCEEECCCCCCCCCCCCCCCCCCCCCCCCCCEEEECCCCC ANVGNYNAGIINVGDHLSGFRNSVPTITGTANISGFVNAGTSISGFFNFGSLMSGFANFD CCCCCCCCCEEECCHHHHHHHHCCCEEEECCCCCEEEECCCCEEHHHHHHHHHHHHHCCC DEVSGYLNGDSRASGWIH CHHCEEECCCCCCCCCCH
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 6.0
TargetDB status: NA
Availability: NA
References: 9634230; 12218036