| Definition | Mycobacterium bovis BCG str. Pasteur 1173P2, complete genome. |
|---|---|
| Accession | NC_008769 |
| Length | 4,374,522 |
Click here to switch to the map view.
The map label for this gene is 121636799
Identifier: 121636799
GI number: 121636799
Start: 1004751
End: 1006397
Strand: Reverse
Name: 121636799
Synonym: BCG_0928c
Alternate gene names: NA
Gene position: 1006397-1004751 (Counterclockwise)
Preceding gene: 121636801
Following gene: 121636798
Centisome position: 23.01
GC content: 65.88
Gene sequence:
>1647_bases ATGGCCCCAACCCCGGGCCGCCGGACCCGAAACGGATCGGTCAACGGGCACCCTGGCATGGCCAACTACCCTCCCGACGA CGCCAACTATCGCCGATCGCGTCGACCTCCGCCGATGCCCAGTGCCAACCGCTATCTCCCGCCGCTGGGCGAGCAGCCCG AACCTGAACGCAGCCGCGTACCGCCACGGACTACAAGGGCGGGCGAGCGGATCACCGTCACCCGCGCCGCGGCCATGCGC AGCCGCGAAATGGGTTCTCGGATGTACTTGCTGGTGCACCGGGCCGCTACCGCAGACGGCGCCGACAAGTCTGGACTGAC GGCATTGACCTGGCCGGTAATGGCGAACTTCGCGGTCGACTCGGCAATGGCGGTAGCACTGGCAAACACACTATTCTTTG CGGCCGCCAGCGGGGAGAGCAAGTCCAGGGTCGCCTTGTACCTGTTGATCACCATCGCGCCGTTCGCCGTGATCGCTCCA CTCATCGGTCCGGCACTCGACCGGCTGCAGCATGGCCGTCGCGTCGCCTTGGCGCTGTCATTCGGACTTCGGACCGCGTT GGCGGTGGTGCTGATCATGAACTACGACGGCGCCACCGGCAGCTTCCCGTCATGGGTGCTCTATCCCTGTGCGCTGGCCA TGATGGTGTTCTCGAAGTCGTTCAGCGTGCTGCGCAGCGCAGTGACACCGAGGGTGATGCCGCCAACCATCGACTTGGTC CGGGTCAACTCACGGCTGACCGTGTTCGGCCTGCTCGGCGGCACCATCGCTGGTGGCGCGATTGCGGCCGGAGTCGAATT CGTCTGCACCCACCTGTTCCAGCTGCCGGGCGCGTTGTTCGTCGTCGTCGCGATCACCATCGCTGGCGCTTCGCTGTCGA TGCGCATTCCGCGCTGGGTCGAGGTGACCAGCGGTGAGGTCCCGGCCACATTGAGCTACCACCGGGATAGGGGCAGACTA CGGCGACGCTGGCCGGAGGAAGTCAAGAACCTCGGCGGAACACTCCGACAACCGTTGGGCCGCAACATCATTACCTCCCT GTGGGGTAACTGCACCATCAAGGTGATGGTCGGCTTTCTGTTCTTGTATCCGGCGTTTGTCGCCAAGGCGCACGAAGCCA ACGGGTGGGTGCAATTGGGCATGCTGGGCCTGATCGGCGCGGCGGCCGCGGTCGGCAACTTCGCCGGCAATTTCACCAGC GCACGCCTGCAGCTAGGCAGGCCAGCTGTGCTGGTGGTGCGCTGCACCGTGCTAGTTACCGTGTTAGCCATCGCGGCCGC GGTGGCCGGCAGCCTGGCAGCGACAGCGATTGCCACCCTGATCACGGCAGGGTCCAGTGCCATTGCTAAAGCCTCGCTGG ACGCCTCGTTGCAGCACGACCTGCCCGAGGAGTCGCGGGCATCGGGGTTTGGGCGTTCCGAGTCGACTCTTCAGCTGGCC TGGGTGCTGGGCGGCGCGGTGGGCGTGTTGGTGTACACCGAGCTGTGGGTGGGCTTCACTGCGGTGAGCGCGCTGCTGAT CCTGGGTCTGGCTCAGACCATCGTCAGCTTCCGCGGCGATTCGCTGATCCCTGGCCTGGGCGGTAATCGGCCCGTGATGG CCGAGCAAGAAACCACCCGTCGTGGTGCGGCGGTGGCGCCGCAGTGA
Upstream 100 bases:
>100_bases GAAGACACGGCCGGCAAGCCACACCCGGTTGGCTACGCCAGGAGTCCGGATAGGACAGAATTGATTTGTGTCCGGACGGC GAGGTGATCATCCGGGCCGG
Downstream 100 bases:
>100_bases AGCGCGGTGTCGCAACGCTGCCGGTGATCCTGGTGATTCTGCTCTCGGTGGCGGCCGGGGCCGGTGCATGGCTGCTAGTA CGCGGACACGGTCCGCAGCA
Product: putative transmembrane protein
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 548; Mature: 547
Protein sequence:
>548_residues MAPTPGRRTRNGSVNGHPGMANYPPDDANYRRSRRPPPMPSANRYLPPLGEQPEPERSRVPPRTTRAGERITVTRAAAMR SREMGSRMYLLVHRAATADGADKSGLTALTWPVMANFAVDSAMAVALANTLFFAAASGESKSRVALYLLITIAPFAVIAP LIGPALDRLQHGRRVALALSFGLRTALAVVLIMNYDGATGSFPSWVLYPCALAMMVFSKSFSVLRSAVTPRVMPPTIDLV RVNSRLTVFGLLGGTIAGGAIAAGVEFVCTHLFQLPGALFVVVAITIAGASLSMRIPRWVEVTSGEVPATLSYHRDRGRL RRRWPEEVKNLGGTLRQPLGRNIITSLWGNCTIKVMVGFLFLYPAFVAKAHEANGWVQLGMLGLIGAAAAVGNFAGNFTS ARLQLGRPAVLVVRCTVLVTVLAIAAAVAGSLAATAIATLITAGSSAIAKASLDASLQHDLPEESRASGFGRSESTLQLA WVLGGAVGVLVYTELWVGFTAVSALLILGLAQTIVSFRGDSLIPGLGGNRPVMAEQETTRRGAAVAPQ
Sequences:
>Translated_548_residues MAPTPGRRTRNGSVNGHPGMANYPPDDANYRRSRRPPPMPSANRYLPPLGEQPEPERSRVPPRTTRAGERITVTRAAAMR SREMGSRMYLLVHRAATADGADKSGLTALTWPVMANFAVDSAMAVALANTLFFAAASGESKSRVALYLLITIAPFAVIAP LIGPALDRLQHGRRVALALSFGLRTALAVVLIMNYDGATGSFPSWVLYPCALAMMVFSKSFSVLRSAVTPRVMPPTIDLV RVNSRLTVFGLLGGTIAGGAIAAGVEFVCTHLFQLPGALFVVVAITIAGASLSMRIPRWVEVTSGEVPATLSYHRDRGRL RRRWPEEVKNLGGTLRQPLGRNIITSLWGNCTIKVMVGFLFLYPAFVAKAHEANGWVQLGMLGLIGAAAAVGNFAGNFTS ARLQLGRPAVLVVRCTVLVTVLAIAAAVAGSLAATAIATLITAGSSAIAKASLDASLQHDLPEESRASGFGRSESTLQLA WVLGGAVGVLVYTELWVGFTAVSALLILGLAQTIVSFRGDSLIPGLGGNRPVMAEQETTRRGAAVAPQ >Mature_547_residues APTPGRRTRNGSVNGHPGMANYPPDDANYRRSRRPPPMPSANRYLPPLGEQPEPERSRVPPRTTRAGERITVTRAAAMRS REMGSRMYLLVHRAATADGADKSGLTALTWPVMANFAVDSAMAVALANTLFFAAASGESKSRVALYLLITIAPFAVIAPL IGPALDRLQHGRRVALALSFGLRTALAVVLIMNYDGATGSFPSWVLYPCALAMMVFSKSFSVLRSAVTPRVMPPTIDLVR VNSRLTVFGLLGGTIAGGAIAAGVEFVCTHLFQLPGALFVVVAITIAGASLSMRIPRWVEVTSGEVPATLSYHRDRGRLR RRWPEEVKNLGGTLRQPLGRNIITSLWGNCTIKVMVGFLFLYPAFVAKAHEANGWVQLGMLGLIGAAAAVGNFAGNFTSA RLQLGRPAVLVVRCTVLVTVLAIAAAVAGSLAATAIATLITAGSSAIAKASLDASLQHDLPEESRASGFGRSESTLQLAW VLGGAVGVLVYTELWVGFTAVSALLILGLAQTIVSFRGDSLIPGLGGNRPVMAEQETTRRGAAVAPQ
Specific function: Unknown
COG id: COG0477
COG function: function code GEPR; Permeases of the major facilitator superfamily
Gene ontology:
Cell location: Cell membrane; Multi-pass membrane protein (Potential)
Metaboloic importance: NA
Operon status: Not Known
Operon components: None
Similarity: To M.leprae ML2143
Homologues:
None
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): Y876_MYCTU (Q10564)
Other databases:
- EMBL: BX842574 - EMBL: AE000516 - PIR: A70780 - RefSeq: NP_215391.1 - RefSeq: NP_335327.1 - ProteinModelPortal: Q10564 - EnsemblBacteria: EBMYCT00000002581 - EnsemblBacteria: EBMYCT00000069910 - GeneID: 885562 - GeneID: 926209 - GenomeReviews: AE000516_GR - GenomeReviews: AL123456_GR - KEGG: mtc:MT0899 - KEGG: mtu:Rv0876c - TIGR: MT0899 - TubercuList: Rv0876c - GeneTree: EBGT00050000014799 - HOGENOM: HBG565082 - OMA: VLQLSWV - ProtClustDB: CLSK871868 - InterPro: IPR011701 - InterPro: IPR016196
Pfam domain/function: PF07690 MFS_1; SSF103473 MFS_gen_substrate_transporter
EC number: NA
Molecular weight: Translated: 57938; Mature: 57807
Theoretical pI: Translated: 11.35; Mature: 11.35
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
HASH(0xcb919ec)-; HASH(0x14d1cf5c)-; HASH(0x14142ec0)-; HASH(0x14210ce4)-; HASH(0x14bc5330)-; HASH(0x1406e8d4)-; HASH(0x14551df8)-; HASH(0x146f84f8)-; HASH(0x13dca488)-; HASH(0x135b9820)-; HASH(0x14b0d9b4)-;
Cys/Met content:
0.7 %Cys (Translated Protein) 2.9 %Met (Translated Protein) 3.6 %Cys+Met (Translated Protein) 0.7 %Cys (Mature Protein) 2.7 %Met (Mature Protein) 3.5 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MAPTPGRRTRNGSVNGHPGMANYPPDDANYRRSRRPPPMPSANRYLPPLGEQPEPERSRV CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHCC PPRTTRAGERITVTRAAAMRSREMGSRMYLLVHRAATADGADKSGLTALTWPVMANFAVD CCCCCCCCCEEEEHHHHHHHHHHCCCEEEEEEEEHHCCCCCCCCCCEEEEHHHHHHHHHH SAMAVALANTLFFAAASGESKSRVALYLLITIAPFAVIAPLIGPALDRLQHGRRVALALS HHHHHHHHHHHHEEECCCCCCCCEEEHHHHHHHHHHHHHHHHHHHHHHHHCCCEEEEEEH FGLRTALAVVLIMNYDGATGSFPSWVLYPCALAMMVFSKSFSVLRSAVTPRVMPPTIDLV HHHHHHHHHHHEEECCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCEEEE RVNSRLTVFGLLGGTIAGGAIAAGVEFVCTHLFQLPGALFVVVAITIAGASLSMRIPRWV EECCCEEEEEECCCHHCCHHHHHHHHHHHHHHHHCCHHHHHHHHHHHCCCCEEECCCCEE EVTSGEVPATLSYHRDRGRLRRRWPEEVKNLGGTLRQPLGRNIITSLWGNCTIKVMVGFL EECCCCCCEEHHHHHHHHHHHHCCHHHHHHCCHHHHHHHCHHHHHHHHCCHHHHHHHHHH FLYPAFVAKAHEANGWVQLGMLGLIGAAAAVGNFAGNFTSARLQLGRPAVLVVRCTVLVT HHHHHHHHHHHCCCCEEEHHHHHHHHHHHHHHHHCCCCCHHHHCCCCCEEHHHHHHHHHH VLAIAAAVAGSLAATAIATLITAGSSAIAKASLDASLQHDLPEESRASGFGRSESTLQLA HHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHCCCHHHHCCCCHHHHCCCCCCCCCEEEH WVLGGAVGVLVYTELWVGFTAVSALLILGLAQTIVSFRGDSLIPGLGGNRPVMAEQETTR HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCHHHC RGAAVAPQ CCCCCCCH >Mature Secondary Structure APTPGRRTRNGSVNGHPGMANYPPDDANYRRSRRPPPMPSANRYLPPLGEQPEPERSRV CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHCC PPRTTRAGERITVTRAAAMRSREMGSRMYLLVHRAATADGADKSGLTALTWPVMANFAVD CCCCCCCCCEEEEHHHHHHHHHHCCCEEEEEEEEHHCCCCCCCCCCEEEEHHHHHHHHHH SAMAVALANTLFFAAASGESKSRVALYLLITIAPFAVIAPLIGPALDRLQHGRRVALALS HHHHHHHHHHHHEEECCCCCCCCEEEHHHHHHHHHHHHHHHHHHHHHHHHCCCEEEEEEH FGLRTALAVVLIMNYDGATGSFPSWVLYPCALAMMVFSKSFSVLRSAVTPRVMPPTIDLV HHHHHHHHHHHEEECCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCEEEE RVNSRLTVFGLLGGTIAGGAIAAGVEFVCTHLFQLPGALFVVVAITIAGASLSMRIPRWV EECCCEEEEEECCCHHCCHHHHHHHHHHHHHHHHCCHHHHHHHHHHHCCCCEEECCCCEE EVTSGEVPATLSYHRDRGRLRRRWPEEVKNLGGTLRQPLGRNIITSLWGNCTIKVMVGFL EECCCCCCEEHHHHHHHHHHHHCCHHHHHHCCHHHHHHHCHHHHHHHHCCHHHHHHHHHH FLYPAFVAKAHEANGWVQLGMLGLIGAAAAVGNFAGNFTSARLQLGRPAVLVVRCTVLVT HHHHHHHHHHHCCCCEEEHHHHHHHHHHHHHHHHCCCCCHHHHCCCCCEEHHHHHHHHHH VLAIAAAVAGSLAATAIATLITAGSSAIAKASLDASLQHDLPEESRASGFGRSESTLQLA HHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHCCCHHHHCCCCHHHHCCCCCCCCCEEEH WVLGGAVGVLVYTELWVGFTAVSALLILGLAQTIVSFRGDSLIPGLGGNRPVMAEQETTR HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCHHHC RGAAVAPQ CCCCCCCH
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 6.0
TargetDB status: NA
Availability: NA
References: 9634230; 12218036