| Definition | Mycobacterium bovis BCG str. Pasteur 1173P2, complete genome. |
|---|---|
| Accession | NC_008769 |
| Length | 4,374,522 |
Click here to switch to the map view.
The map label for this gene is 121636884
Identifier: 121636884
GI number: 121636884
Start: 1101732
End: 1103750
Strand: Direct
Name: 121636884
Synonym: BCG_1013
Alternate gene names: NA
Gene position: 1101732-1103750 (Clockwise)
Preceding gene: 121636883
Following gene: 121636885
Centisome position: 25.19
GC content: 69.09
Gene sequence:
>2019_bases ATGGCTAAGTCTGATGGTGACGACCCGCTGCGCCCGGCTTCGCCGCGCTTGCGATCGTCACGACGGCACTCGCTACGCTA CTCGGCGTACACCGGCGGGCCCGACCCGCTGGCCCCGCCGGTGGATCTGCGGGATGCGCTGGAACAGATTGGCCAAGACG TCATGGCGGGCGCCTCGCCGCGCCGGGCGCTGTCCGAGCTGCTGCGGCGGGGCACCAGGAACCTGACCGGCGCCGACCGG CTGGCGGCCGAGGTGAACCGCCGCCGACGGGAGTTGTTGCGCCGCAACAACTTAGATGGCACCTTGCAGGAGATCAAGAA GCTGCTCGACGAGGCCGTGCTGGCCGAACGCAAGGAGCTGGCCCGCGCGCTAGACGACGACGCCCGCTTCGCCGAGCTGC AGCTGGACGCGCTTCCGGCCTCGCCGGCCAAGGCAGTACAGGAGCTGGCCGAATACCGCTGGCGCAGCGGGCAGGCCCGC GAAAAGTATGAGCAGATCAAGGATTTGCTCGGCCGTGAGCTGCTCGACCAACGCTTTGCCGGCATGAAGCAGGCGCTTGC CGGTGCCACCGACGACGATCGCCGGCGGGTCACCGAGATGCTCGACGACCTCAACGACCTGTTGGATAAGCACGCCCGCG GTGAAGATACGCAGCGGGACTTCGACGAGTTCATGACCAAGCACGGCGAGTTCTTCCCGGAGAACCCGCGCAACGTCGAG GAGCTGCTGGACTCGCTGGCCAAGCGAGCCGCCGCCGCGCAGCGGTTCCGCAACAGCCTGAGCCAGGAACAGCGGGACGA GCTGGACGCGTTGGCGCAGCAGGCATTTGGCTCTCCGGCGTTGATGCGGGCGCTGGACCGTTTGGATGCGCATCTGCAGG CCGCCCGTCCCGGCGAAGACTGGACCGGCTCGCAGCAGTTCTCCGGTGATAATCCGTTCGGCATGGGGGAAGGCACCCAG GCGCTGGCCGACATTGCCGAGCTGGAGCAGCTGGCCGAGCAGCTGTCGCAGAGCTATCCGGGCGCCAGCATGGACGATGT CGACCTGGACGCGCTGGCCCGTCAGCTCGGCGACCAGGCCGCCGTCGACGCCCGGACGCTGGCTGAATTGGAACGCGCGC TGGTCAATCAGGGCTTCCTGGACCGCGGTTCCGACGGCCAGTGGCGGCTCTCGCCGAAGGCCATGCGCCGCCTCGGCGAA ACGGCGTTACGCGATGTGGCGCAACAACTTTCCGGGCGCCACGGCGAGCGTGATCACCGGCGTGCCGGCGCCGCGGGCGA GCTGACCGGTGCGACGCGGCCCTGGCAGTTCGGCGACACCGAGCCGTGGCACGTCGCCCGCACGCTGACCAATGCCGTGC TGCGCCAAGCCGCGGCCGTGCATGACCGCATCCGGATCACCGTCGAGGATGTCGAGGTCGCCGAGACCGAAACGCGCACC CAGGCCGCTGTTGCGTTGTTGGTGGACACCTCGTTTTCGATGGTGATGGAGAATCGCTGGTTGCCGATGAAGCGCACGGC GCTGGCGCTGCACCACCTGGTGTGCACCCGGTTCCGCTCGGATGCCTTGCAGATCATCGCGTTTGGGCGCTACGCCCGCA CGGTGACGGCGGCCGAGCTGACGGGGTTGGCGGGTGTCTACGAGCAGGGCACCAACCTGCACCATGCGCTCGCGCTGGCC GGCCGGCACCTGCGCCGGCACGCAGGCGCCCAGCCCGTGGTGCTGGTGGTGACCGACGGCGAGCCGACCGCCCACCTGGA GGACTTCGACGGCGACGGTACGTCGGTGTTCTTTGATTACCCGCCCCATCCGCGCACCATCGCCCACACCGTGCGCGGGT TTGACGACATGGCGCGGCTGGGTGCGCAGGTGACGATCTTCCGGTTGGGCAGTGACCCCGGTCTGGCTCGGTTCATTGAC CAGGTTGCGCGACGGGTGCAGGGCCGCGTGGTGGTGCCCGATCTCGACGGGCTGGGCGCGGCGGTGGTGGGCGACTACCT GCGCTTCCGGCGGCGCTAG
Upstream 100 bases:
>100_bases GAATCCGAGGGGGAGCGTGCCGCGGCACTGGAACTGGCGTTGGAGGCGCTATACCTGGCCAAGCGCGTTGACAAGGTCTG CGGGGAGGGCCAGACCGTCT
Downstream 100 bases:
>100_bases TTTGTTGCAATCATGGTGCTAGCATCGTGCTAGCAATATGCTAACATAGTGCGATGAAGACGCTGTATCTGCGCAATGTG CCGGACGACGTGGTCGAGCG
Product: hypothetical protein
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 672; Mature: 671
Protein sequence:
>672_residues MAKSDGDDPLRPASPRLRSSRRHSLRYSAYTGGPDPLAPPVDLRDALEQIGQDVMAGASPRRALSELLRRGTRNLTGADR LAAEVNRRRRELLRRNNLDGTLQEIKKLLDEAVLAERKELARALDDDARFAELQLDALPASPAKAVQELAEYRWRSGQAR EKYEQIKDLLGRELLDQRFAGMKQALAGATDDDRRRVTEMLDDLNDLLDKHARGEDTQRDFDEFMTKHGEFFPENPRNVE ELLDSLAKRAAAAQRFRNSLSQEQRDELDALAQQAFGSPALMRALDRLDAHLQAARPGEDWTGSQQFSGDNPFGMGEGTQ ALADIAELEQLAEQLSQSYPGASMDDVDLDALARQLGDQAAVDARTLAELERALVNQGFLDRGSDGQWRLSPKAMRRLGE TALRDVAQQLSGRHGERDHRRAGAAGELTGATRPWQFGDTEPWHVARTLTNAVLRQAAAVHDRIRITVEDVEVAETETRT QAAVALLVDTSFSMVMENRWLPMKRTALALHHLVCTRFRSDALQIIAFGRYARTVTAAELTGLAGVYEQGTNLHHALALA GRHLRRHAGAQPVVLVVTDGEPTAHLEDFDGDGTSVFFDYPPHPRTIAHTVRGFDDMARLGAQVTIFRLGSDPGLARFID QVARRVQGRVVVPDLDGLGAAVVGDYLRFRRR
Sequences:
>Translated_672_residues MAKSDGDDPLRPASPRLRSSRRHSLRYSAYTGGPDPLAPPVDLRDALEQIGQDVMAGASPRRALSELLRRGTRNLTGADR LAAEVNRRRRELLRRNNLDGTLQEIKKLLDEAVLAERKELARALDDDARFAELQLDALPASPAKAVQELAEYRWRSGQAR EKYEQIKDLLGRELLDQRFAGMKQALAGATDDDRRRVTEMLDDLNDLLDKHARGEDTQRDFDEFMTKHGEFFPENPRNVE ELLDSLAKRAAAAQRFRNSLSQEQRDELDALAQQAFGSPALMRALDRLDAHLQAARPGEDWTGSQQFSGDNPFGMGEGTQ ALADIAELEQLAEQLSQSYPGASMDDVDLDALARQLGDQAAVDARTLAELERALVNQGFLDRGSDGQWRLSPKAMRRLGE TALRDVAQQLSGRHGERDHRRAGAAGELTGATRPWQFGDTEPWHVARTLTNAVLRQAAAVHDRIRITVEDVEVAETETRT QAAVALLVDTSFSMVMENRWLPMKRTALALHHLVCTRFRSDALQIIAFGRYARTVTAAELTGLAGVYEQGTNLHHALALA GRHLRRHAGAQPVVLVVTDGEPTAHLEDFDGDGTSVFFDYPPHPRTIAHTVRGFDDMARLGAQVTIFRLGSDPGLARFID QVARRVQGRVVVPDLDGLGAAVVGDYLRFRRR >Mature_671_residues AKSDGDDPLRPASPRLRSSRRHSLRYSAYTGGPDPLAPPVDLRDALEQIGQDVMAGASPRRALSELLRRGTRNLTGADRL AAEVNRRRRELLRRNNLDGTLQEIKKLLDEAVLAERKELARALDDDARFAELQLDALPASPAKAVQELAEYRWRSGQARE KYEQIKDLLGRELLDQRFAGMKQALAGATDDDRRRVTEMLDDLNDLLDKHARGEDTQRDFDEFMTKHGEFFPENPRNVEE LLDSLAKRAAAAQRFRNSLSQEQRDELDALAQQAFGSPALMRALDRLDAHLQAARPGEDWTGSQQFSGDNPFGMGEGTQA LADIAELEQLAEQLSQSYPGASMDDVDLDALARQLGDQAAVDARTLAELERALVNQGFLDRGSDGQWRLSPKAMRRLGET ALRDVAQQLSGRHGERDHRRAGAAGELTGATRPWQFGDTEPWHVARTLTNAVLRQAAAVHDRIRITVEDVEVAETETRTQ AAVALLVDTSFSMVMENRWLPMKRTALALHHLVCTRFRSDALQIIAFGRYARTVTAAELTGLAGVYEQGTNLHHALALAG RHLRRHAGAQPVVLVVTDGEPTAHLEDFDGDGTSVFFDYPPHPRTIAHTVRGFDDMARLGAQVTIFRLGSDPGLARFIDQ VARRVQGRVVVPDLDGLGAAVVGDYLRFRRR
Specific function: Unknown
COG id: COG4867
COG function: function code R; Uncharacterized protein with a von Willebrand factor type A (vWA) domain
Gene ontology:
Cell location: Cytoplasmic
Metaboloic importance: NA
Operon status: Not Known
Operon components: None
Similarity: NA
Homologues:
None
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): Y959_MYCTU (P0A5D7)
Other databases:
- EMBL: BX842575 - EMBL: AE000516 - PIR: E70717 - RefSeq: NP_215474.1 - RefSeq: NP_335420.1 - ProteinModelPortal: P0A5D7 - EnsemblBacteria: EBMYCT00000001238 - EnsemblBacteria: EBMYCT00000071003 - GeneID: 885329 - GeneID: 926378 - GenomeReviews: AE000516_GR - GenomeReviews: AL123456_GR - KEGG: mtc:MT0986 - KEGG: mtu:Rv0959 - TIGR: MT0986 - TubercuList: Rv0959 - GeneTree: EBGT00050000018229 - HOGENOM: HBG322384 - OMA: GRWVPMK - ProtClustDB: CLSK871877 - InterPro: IPR002035 - SMART: SM00327
Pfam domain/function: NA
EC number: NA
Molecular weight: Translated: 74637; Mature: 74505
Theoretical pI: Translated: 6.20; Mature: 6.20
Prosite motif: PS00639 THIOL_PROTEASE_HIS
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.1 %Cys (Translated Protein) 1.9 %Met (Translated Protein) 2.1 %Cys+Met (Translated Protein) 0.1 %Cys (Mature Protein) 1.8 %Met (Mature Protein) 1.9 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MAKSDGDDPLRPASPRLRSSRRHSLRYSAYTGGPDPLAPPVDLRDALEQIGQDVMAGASP CCCCCCCCCCCCCCCHHHHHHHHHCEEEEECCCCCCCCCCCCHHHHHHHHHHHHHCCCCH RRALSELLRRGTRNLTGADRLAAEVNRRRRELLRRNNLDGTLQEIKKLLDEAVLAERKEL HHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHH ARALDDDARFAELQLDALPASPAKAVQELAEYRWRSGQAREKYEQIKDLLGRELLDQRFA HHHHCCCHHHHHHHHHCCCCCHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHH GMKQALAGATDDDRRRVTEMLDDLNDLLDKHARGEDTQRDFDEFMTKHGEFFPENPRNVE HHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHCCCCCCCCCCCHH ELLDSLAKRAAAAQRFRNSLSQEQRDELDALAQQAFGSPALMRALDRLDAHLQAARPGED HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHCCCCCC WTGSQQFSGDNPFGMGEGTQALADIAELEQLAEQLSQSYPGASMDDVDLDALARQLGDQA CCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHCCHH AVDARTLAELERALVNQGFLDRGSDGQWRLSPKAMRRLGETALRDVAQQLSGRHGERDHR HHHHHHHHHHHHHHHHCCCCCCCCCCCEEECHHHHHHHHHHHHHHHHHHHCCCCCCCHHH RAGAAGELTGATRPWQFGDTEPWHVARTLTNAVLRQAAAVHDRIRITVEDVEVAETETRT HCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHEEEEEHHHHHHHHHHH QAAVALLVDTSFSMVMENRWLPMKRTALALHHLVCTRFRSDALQIIAFGRYARTVTAAEL HHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH TGLAGVYEQGTNLHHALALAGRHLRRHAGAQPVVLVVTDGEPTAHLEDFDGDGTSVFFDY HHHHHHHHCCCCHHHHHHHHHHHHHHHCCCCCEEEEEECCCCCCCCCCCCCCCCEEEEEC PPHPRTIAHTVRGFDDMARLGAQVTIFRLGSDPGLARFIDQVARRVQGRVVVPDLDGLGA CCCCHHHHHHHHCHHHHHHCCCEEEEEEECCCCCHHHHHHHHHHHHCCCEEECCCCCCHH AVVGDYLRFRRR HHHHHHHHHHCC >Mature Secondary Structure AKSDGDDPLRPASPRLRSSRRHSLRYSAYTGGPDPLAPPVDLRDALEQIGQDVMAGASP CCCCCCCCCCCCCCHHHHHHHHHCEEEEECCCCCCCCCCCCHHHHHHHHHHHHHCCCCH RRALSELLRRGTRNLTGADRLAAEVNRRRRELLRRNNLDGTLQEIKKLLDEAVLAERKEL HHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHH ARALDDDARFAELQLDALPASPAKAVQELAEYRWRSGQAREKYEQIKDLLGRELLDQRFA HHHHCCCHHHHHHHHHCCCCCHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHH GMKQALAGATDDDRRRVTEMLDDLNDLLDKHARGEDTQRDFDEFMTKHGEFFPENPRNVE HHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHCCCCCCCCCCCHH ELLDSLAKRAAAAQRFRNSLSQEQRDELDALAQQAFGSPALMRALDRLDAHLQAARPGED HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHCCCCCC WTGSQQFSGDNPFGMGEGTQALADIAELEQLAEQLSQSYPGASMDDVDLDALARQLGDQA CCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHCCHH AVDARTLAELERALVNQGFLDRGSDGQWRLSPKAMRRLGETALRDVAQQLSGRHGERDHR HHHHHHHHHHHHHHHHCCCCCCCCCCCEEECHHHHHHHHHHHHHHHHHHHCCCCCCCHHH RAGAAGELTGATRPWQFGDTEPWHVARTLTNAVLRQAAAVHDRIRITVEDVEVAETETRT HCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHEEEEEHHHHHHHHHHH QAAVALLVDTSFSMVMENRWLPMKRTALALHHLVCTRFRSDALQIIAFGRYARTVTAAEL HHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH TGLAGVYEQGTNLHHALALAGRHLRRHAGAQPVVLVVTDGEPTAHLEDFDGDGTSVFFDY HHHHHHHHCCCCHHHHHHHHHHHHHHHCCCCCEEEEEECCCCCCCCCCCCCCCCEEEEEC PPHPRTIAHTVRGFDDMARLGAQVTIFRLGSDPGLARFIDQVARRVQGRVVVPDLDGLGA CCCCHHHHHHHHCHHHHHHCCCEEEEEEECCCCCHHHHHHHHHHHHCCCEEECCCCCCHH AVVGDYLRFRRR HHHHHHHHHHCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 9634230; 12218036