Definition Mycobacterium bovis BCG str. Pasteur 1173P2, complete genome.
Accession NC_008769
Length 4,374,522

Click here to switch to the map view.

The map label for this gene is 121636884

Identifier: 121636884

GI number: 121636884

Start: 1101732

End: 1103750

Strand: Direct

Name: 121636884

Synonym: BCG_1013

Alternate gene names: NA

Gene position: 1101732-1103750 (Clockwise)

Preceding gene: 121636883

Following gene: 121636885

Centisome position: 25.19

GC content: 69.09

Gene sequence:

>2019_bases
ATGGCTAAGTCTGATGGTGACGACCCGCTGCGCCCGGCTTCGCCGCGCTTGCGATCGTCACGACGGCACTCGCTACGCTA
CTCGGCGTACACCGGCGGGCCCGACCCGCTGGCCCCGCCGGTGGATCTGCGGGATGCGCTGGAACAGATTGGCCAAGACG
TCATGGCGGGCGCCTCGCCGCGCCGGGCGCTGTCCGAGCTGCTGCGGCGGGGCACCAGGAACCTGACCGGCGCCGACCGG
CTGGCGGCCGAGGTGAACCGCCGCCGACGGGAGTTGTTGCGCCGCAACAACTTAGATGGCACCTTGCAGGAGATCAAGAA
GCTGCTCGACGAGGCCGTGCTGGCCGAACGCAAGGAGCTGGCCCGCGCGCTAGACGACGACGCCCGCTTCGCCGAGCTGC
AGCTGGACGCGCTTCCGGCCTCGCCGGCCAAGGCAGTACAGGAGCTGGCCGAATACCGCTGGCGCAGCGGGCAGGCCCGC
GAAAAGTATGAGCAGATCAAGGATTTGCTCGGCCGTGAGCTGCTCGACCAACGCTTTGCCGGCATGAAGCAGGCGCTTGC
CGGTGCCACCGACGACGATCGCCGGCGGGTCACCGAGATGCTCGACGACCTCAACGACCTGTTGGATAAGCACGCCCGCG
GTGAAGATACGCAGCGGGACTTCGACGAGTTCATGACCAAGCACGGCGAGTTCTTCCCGGAGAACCCGCGCAACGTCGAG
GAGCTGCTGGACTCGCTGGCCAAGCGAGCCGCCGCCGCGCAGCGGTTCCGCAACAGCCTGAGCCAGGAACAGCGGGACGA
GCTGGACGCGTTGGCGCAGCAGGCATTTGGCTCTCCGGCGTTGATGCGGGCGCTGGACCGTTTGGATGCGCATCTGCAGG
CCGCCCGTCCCGGCGAAGACTGGACCGGCTCGCAGCAGTTCTCCGGTGATAATCCGTTCGGCATGGGGGAAGGCACCCAG
GCGCTGGCCGACATTGCCGAGCTGGAGCAGCTGGCCGAGCAGCTGTCGCAGAGCTATCCGGGCGCCAGCATGGACGATGT
CGACCTGGACGCGCTGGCCCGTCAGCTCGGCGACCAGGCCGCCGTCGACGCCCGGACGCTGGCTGAATTGGAACGCGCGC
TGGTCAATCAGGGCTTCCTGGACCGCGGTTCCGACGGCCAGTGGCGGCTCTCGCCGAAGGCCATGCGCCGCCTCGGCGAA
ACGGCGTTACGCGATGTGGCGCAACAACTTTCCGGGCGCCACGGCGAGCGTGATCACCGGCGTGCCGGCGCCGCGGGCGA
GCTGACCGGTGCGACGCGGCCCTGGCAGTTCGGCGACACCGAGCCGTGGCACGTCGCCCGCACGCTGACCAATGCCGTGC
TGCGCCAAGCCGCGGCCGTGCATGACCGCATCCGGATCACCGTCGAGGATGTCGAGGTCGCCGAGACCGAAACGCGCACC
CAGGCCGCTGTTGCGTTGTTGGTGGACACCTCGTTTTCGATGGTGATGGAGAATCGCTGGTTGCCGATGAAGCGCACGGC
GCTGGCGCTGCACCACCTGGTGTGCACCCGGTTCCGCTCGGATGCCTTGCAGATCATCGCGTTTGGGCGCTACGCCCGCA
CGGTGACGGCGGCCGAGCTGACGGGGTTGGCGGGTGTCTACGAGCAGGGCACCAACCTGCACCATGCGCTCGCGCTGGCC
GGCCGGCACCTGCGCCGGCACGCAGGCGCCCAGCCCGTGGTGCTGGTGGTGACCGACGGCGAGCCGACCGCCCACCTGGA
GGACTTCGACGGCGACGGTACGTCGGTGTTCTTTGATTACCCGCCCCATCCGCGCACCATCGCCCACACCGTGCGCGGGT
TTGACGACATGGCGCGGCTGGGTGCGCAGGTGACGATCTTCCGGTTGGGCAGTGACCCCGGTCTGGCTCGGTTCATTGAC
CAGGTTGCGCGACGGGTGCAGGGCCGCGTGGTGGTGCCCGATCTCGACGGGCTGGGCGCGGCGGTGGTGGGCGACTACCT
GCGCTTCCGGCGGCGCTAG

Upstream 100 bases:

>100_bases
GAATCCGAGGGGGAGCGTGCCGCGGCACTGGAACTGGCGTTGGAGGCGCTATACCTGGCCAAGCGCGTTGACAAGGTCTG
CGGGGAGGGCCAGACCGTCT

Downstream 100 bases:

>100_bases
TTTGTTGCAATCATGGTGCTAGCATCGTGCTAGCAATATGCTAACATAGTGCGATGAAGACGCTGTATCTGCGCAATGTG
CCGGACGACGTGGTCGAGCG

Product: hypothetical protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 672; Mature: 671

Protein sequence:

>672_residues
MAKSDGDDPLRPASPRLRSSRRHSLRYSAYTGGPDPLAPPVDLRDALEQIGQDVMAGASPRRALSELLRRGTRNLTGADR
LAAEVNRRRRELLRRNNLDGTLQEIKKLLDEAVLAERKELARALDDDARFAELQLDALPASPAKAVQELAEYRWRSGQAR
EKYEQIKDLLGRELLDQRFAGMKQALAGATDDDRRRVTEMLDDLNDLLDKHARGEDTQRDFDEFMTKHGEFFPENPRNVE
ELLDSLAKRAAAAQRFRNSLSQEQRDELDALAQQAFGSPALMRALDRLDAHLQAARPGEDWTGSQQFSGDNPFGMGEGTQ
ALADIAELEQLAEQLSQSYPGASMDDVDLDALARQLGDQAAVDARTLAELERALVNQGFLDRGSDGQWRLSPKAMRRLGE
TALRDVAQQLSGRHGERDHRRAGAAGELTGATRPWQFGDTEPWHVARTLTNAVLRQAAAVHDRIRITVEDVEVAETETRT
QAAVALLVDTSFSMVMENRWLPMKRTALALHHLVCTRFRSDALQIIAFGRYARTVTAAELTGLAGVYEQGTNLHHALALA
GRHLRRHAGAQPVVLVVTDGEPTAHLEDFDGDGTSVFFDYPPHPRTIAHTVRGFDDMARLGAQVTIFRLGSDPGLARFID
QVARRVQGRVVVPDLDGLGAAVVGDYLRFRRR

Sequences:

>Translated_672_residues
MAKSDGDDPLRPASPRLRSSRRHSLRYSAYTGGPDPLAPPVDLRDALEQIGQDVMAGASPRRALSELLRRGTRNLTGADR
LAAEVNRRRRELLRRNNLDGTLQEIKKLLDEAVLAERKELARALDDDARFAELQLDALPASPAKAVQELAEYRWRSGQAR
EKYEQIKDLLGRELLDQRFAGMKQALAGATDDDRRRVTEMLDDLNDLLDKHARGEDTQRDFDEFMTKHGEFFPENPRNVE
ELLDSLAKRAAAAQRFRNSLSQEQRDELDALAQQAFGSPALMRALDRLDAHLQAARPGEDWTGSQQFSGDNPFGMGEGTQ
ALADIAELEQLAEQLSQSYPGASMDDVDLDALARQLGDQAAVDARTLAELERALVNQGFLDRGSDGQWRLSPKAMRRLGE
TALRDVAQQLSGRHGERDHRRAGAAGELTGATRPWQFGDTEPWHVARTLTNAVLRQAAAVHDRIRITVEDVEVAETETRT
QAAVALLVDTSFSMVMENRWLPMKRTALALHHLVCTRFRSDALQIIAFGRYARTVTAAELTGLAGVYEQGTNLHHALALA
GRHLRRHAGAQPVVLVVTDGEPTAHLEDFDGDGTSVFFDYPPHPRTIAHTVRGFDDMARLGAQVTIFRLGSDPGLARFID
QVARRVQGRVVVPDLDGLGAAVVGDYLRFRRR
>Mature_671_residues
AKSDGDDPLRPASPRLRSSRRHSLRYSAYTGGPDPLAPPVDLRDALEQIGQDVMAGASPRRALSELLRRGTRNLTGADRL
AAEVNRRRRELLRRNNLDGTLQEIKKLLDEAVLAERKELARALDDDARFAELQLDALPASPAKAVQELAEYRWRSGQARE
KYEQIKDLLGRELLDQRFAGMKQALAGATDDDRRRVTEMLDDLNDLLDKHARGEDTQRDFDEFMTKHGEFFPENPRNVEE
LLDSLAKRAAAAQRFRNSLSQEQRDELDALAQQAFGSPALMRALDRLDAHLQAARPGEDWTGSQQFSGDNPFGMGEGTQA
LADIAELEQLAEQLSQSYPGASMDDVDLDALARQLGDQAAVDARTLAELERALVNQGFLDRGSDGQWRLSPKAMRRLGET
ALRDVAQQLSGRHGERDHRRAGAAGELTGATRPWQFGDTEPWHVARTLTNAVLRQAAAVHDRIRITVEDVEVAETETRTQ
AAVALLVDTSFSMVMENRWLPMKRTALALHHLVCTRFRSDALQIIAFGRYARTVTAAELTGLAGVYEQGTNLHHALALAG
RHLRRHAGAQPVVLVVTDGEPTAHLEDFDGDGTSVFFDYPPHPRTIAHTVRGFDDMARLGAQVTIFRLGSDPGLARFIDQ
VARRVQGRVVVPDLDGLGAAVVGDYLRFRRR

Specific function: Unknown

COG id: COG4867

COG function: function code R; Uncharacterized protein with a von Willebrand factor type A (vWA) domain

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): Y959_MYCTU (P0A5D7)

Other databases:

- EMBL:   BX842575
- EMBL:   AE000516
- PIR:   E70717
- RefSeq:   NP_215474.1
- RefSeq:   NP_335420.1
- ProteinModelPortal:   P0A5D7
- EnsemblBacteria:   EBMYCT00000001238
- EnsemblBacteria:   EBMYCT00000071003
- GeneID:   885329
- GeneID:   926378
- GenomeReviews:   AE000516_GR
- GenomeReviews:   AL123456_GR
- KEGG:   mtc:MT0986
- KEGG:   mtu:Rv0959
- TIGR:   MT0986
- TubercuList:   Rv0959
- GeneTree:   EBGT00050000018229
- HOGENOM:   HBG322384
- OMA:   GRWVPMK
- ProtClustDB:   CLSK871877
- InterPro:   IPR002035
- SMART:   SM00327

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 74637; Mature: 74505

Theoretical pI: Translated: 6.20; Mature: 6.20

Prosite motif: PS00639 THIOL_PROTEASE_HIS

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.1 %Cys     (Translated Protein)
1.9 %Met     (Translated Protein)
2.1 %Cys+Met (Translated Protein)
0.1 %Cys     (Mature Protein)
1.8 %Met     (Mature Protein)
1.9 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MAKSDGDDPLRPASPRLRSSRRHSLRYSAYTGGPDPLAPPVDLRDALEQIGQDVMAGASP
CCCCCCCCCCCCCCCHHHHHHHHHCEEEEECCCCCCCCCCCCHHHHHHHHHHHHHCCCCH
RRALSELLRRGTRNLTGADRLAAEVNRRRRELLRRNNLDGTLQEIKKLLDEAVLAERKEL
HHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHH
ARALDDDARFAELQLDALPASPAKAVQELAEYRWRSGQAREKYEQIKDLLGRELLDQRFA
HHHHCCCHHHHHHHHHCCCCCHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHH
GMKQALAGATDDDRRRVTEMLDDLNDLLDKHARGEDTQRDFDEFMTKHGEFFPENPRNVE
HHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHCCCCCCCCCCCHH
ELLDSLAKRAAAAQRFRNSLSQEQRDELDALAQQAFGSPALMRALDRLDAHLQAARPGED
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHCCCCCC
WTGSQQFSGDNPFGMGEGTQALADIAELEQLAEQLSQSYPGASMDDVDLDALARQLGDQA
CCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHCCHH
AVDARTLAELERALVNQGFLDRGSDGQWRLSPKAMRRLGETALRDVAQQLSGRHGERDHR
HHHHHHHHHHHHHHHHCCCCCCCCCCCEEECHHHHHHHHHHHHHHHHHHHCCCCCCCHHH
RAGAAGELTGATRPWQFGDTEPWHVARTLTNAVLRQAAAVHDRIRITVEDVEVAETETRT
HCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHEEEEEHHHHHHHHHHH
QAAVALLVDTSFSMVMENRWLPMKRTALALHHLVCTRFRSDALQIIAFGRYARTVTAAEL
HHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
TGLAGVYEQGTNLHHALALAGRHLRRHAGAQPVVLVVTDGEPTAHLEDFDGDGTSVFFDY
HHHHHHHHCCCCHHHHHHHHHHHHHHHCCCCCEEEEEECCCCCCCCCCCCCCCCEEEEEC
PPHPRTIAHTVRGFDDMARLGAQVTIFRLGSDPGLARFIDQVARRVQGRVVVPDLDGLGA
CCCCHHHHHHHHCHHHHHHCCCEEEEEEECCCCCHHHHHHHHHHHHCCCEEECCCCCCHH
AVVGDYLRFRRR
HHHHHHHHHHCC
>Mature Secondary Structure 
AKSDGDDPLRPASPRLRSSRRHSLRYSAYTGGPDPLAPPVDLRDALEQIGQDVMAGASP
CCCCCCCCCCCCCCHHHHHHHHHCEEEEECCCCCCCCCCCCHHHHHHHHHHHHHCCCCH
RRALSELLRRGTRNLTGADRLAAEVNRRRRELLRRNNLDGTLQEIKKLLDEAVLAERKEL
HHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHH
ARALDDDARFAELQLDALPASPAKAVQELAEYRWRSGQAREKYEQIKDLLGRELLDQRFA
HHHHCCCHHHHHHHHHCCCCCHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHH
GMKQALAGATDDDRRRVTEMLDDLNDLLDKHARGEDTQRDFDEFMTKHGEFFPENPRNVE
HHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHCCCCCCCCCCCHH
ELLDSLAKRAAAAQRFRNSLSQEQRDELDALAQQAFGSPALMRALDRLDAHLQAARPGED
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHCCCCCC
WTGSQQFSGDNPFGMGEGTQALADIAELEQLAEQLSQSYPGASMDDVDLDALARQLGDQA
CCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHCCHH
AVDARTLAELERALVNQGFLDRGSDGQWRLSPKAMRRLGETALRDVAQQLSGRHGERDHR
HHHHHHHHHHHHHHHHCCCCCCCCCCCEEECHHHHHHHHHHHHHHHHHHHCCCCCCCHHH
RAGAAGELTGATRPWQFGDTEPWHVARTLTNAVLRQAAAVHDRIRITVEDVEVAETETRT
HCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHEEEEEHHHHHHHHHHH
QAAVALLVDTSFSMVMENRWLPMKRTALALHHLVCTRFRSDALQIIAFGRYARTVTAAEL
HHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
TGLAGVYEQGTNLHHALALAGRHLRRHAGAQPVVLVVTDGEPTAHLEDFDGDGTSVFFDY
HHHHHHHHCCCCHHHHHHHHHHHHHHHCCCCCEEEEEECCCCCCCCCCCCCCCCEEEEEC
PPHPRTIAHTVRGFDDMARLGAQVTIFRLGSDPGLARFIDQVARRVQGRVVVPDLDGLGA
CCCCHHHHHHHHCHHHHHHCCCEEEEEEECCCCCHHHHHHHHHHHHCCCEEECCCCCCHH
AVVGDYLRFRRR
HHHHHHHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 9634230; 12218036