Definition Mycobacterium bovis BCG str. Pasteur 1173P2, complete genome.
Accession NC_008769
Length 4,374,522

Click here to switch to the map view.

The map label for this gene is 121636896

Identifier: 121636896

GI number: 121636896

Start: 1111528

End: 1112160

Strand: Direct

Name: 121636896

Synonym: BCG_1024

Alternate gene names: NA

Gene position: 1111528-1112160 (Clockwise)

Preceding gene: 121636895

Following gene: 121636903

Centisome position: 25.41

GC content: 62.09

Gene sequence:

>633_bases
ATGATCCATGACCTGATGCTTCGTTGGGTGGTTACCGGCCTGTTCGTGCTGACCGCCGCCGAATGTGGTCTGGCAATCAT
CGCCAAACGCCGACCGTGGACGTTGATCGTCAACCACGGGTTGCATTTCGCAATGGCCGTTGCGATGGCGGTGATGGCCT
GGCCGTGGGGCGCGCGGGTTCCGACGACGGGACCTGCGGTATTTTTCTTGCTGGCGGCCGTGTGGTTTGGGGCGACGGCC
GTCGTTGCGGTCCGCGGGACCGCTACGCGTGGACTGTACGGATATCACGGCTTGATGATGCTGGCCACAGCCTGGATGTA
TGCCGCCATGAATCCTCGTTTGCTCCCTGTCCGCTCGTGCACCGAATACGCCACCGAGCCGGATGGGTCAATGCCGGCTA
TGGACATGACTGCGATGAACATGCCGCCGAATAGCGGGTCACCCATCTGGTTCAGCGCGGTGAACTGGATCGGTACGGTC
GGCTTCGCGGTTGCGGCGGTTTTCTGGGCATGCAGGTTTGTCATGGAGCGGCGGCAGGAGGCGACCCAGTCCAGGTTGCC
GGGCAGCATAGGCCAAGCGATGATGGCGGCCGGTATGGCGATGTTGTTCTTCGCCATGCTGTTTCCGGTCTGA

Upstream 100 bases:

>100_bases
TGAACCCGGTCGTGGCGGGCGCGGCGATGGGGTTCTCCTCGGTCAGCGTGGTGACCAACTCACTGCGGTTACGCCGCTTC
GGCCGCGACGGCCGAACCGC

Downstream 100 bases:

>100_bases
GGCAGTTCGCCGCCTGTGTGTCCGAACCGCAAGGTAATTCGGAATAGGCTGTTCCCAACCTCCTGCGTCGTAGGCGGGGG
CCCGGCGGGCCTAGTCAGCG

Product: putative integral membrane protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 210; Mature: 210

Protein sequence:

>210_residues
MIHDLMLRWVVTGLFVLTAAECGLAIIAKRRPWTLIVNHGLHFAMAVAMAVMAWPWGARVPTTGPAVFFLLAAVWFGATA
VVAVRGTATRGLYGYHGLMMLATAWMYAAMNPRLLPVRSCTEYATEPDGSMPAMDMTAMNMPPNSGSPIWFSAVNWIGTV
GFAVAAVFWACRFVMERRQEATQSRLPGSIGQAMMAAGMAMLFFAMLFPV

Sequences:

>Translated_210_residues
MIHDLMLRWVVTGLFVLTAAECGLAIIAKRRPWTLIVNHGLHFAMAVAMAVMAWPWGARVPTTGPAVFFLLAAVWFGATA
VVAVRGTATRGLYGYHGLMMLATAWMYAAMNPRLLPVRSCTEYATEPDGSMPAMDMTAMNMPPNSGSPIWFSAVNWIGTV
GFAVAAVFWACRFVMERRQEATQSRLPGSIGQAMMAAGMAMLFFAMLFPV
>Mature_210_residues
MIHDLMLRWVVTGLFVLTAAECGLAIIAKRRPWTLIVNHGLHFAMAVAMAVMAWPWGARVPTTGPAVFFLLAAVWFGATA
VVAVRGTATRGLYGYHGLMMLATAWMYAAMNPRLLPVRSCTEYATEPDGSMPAMDMTAMNMPPNSGSPIWFSAVNWIGTV
GFAVAAVFWACRFVMERRQEATQSRLPGSIGQAMMAAGMAMLFFAMLFPV

Specific function: Unknown

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cell membrane; Multi-pass membrane protein (Potential)

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): Y970_MYCTU (P64781)

Other databases:

- EMBL:   BX842575
- EMBL:   AE000516
- PIR:   H70718
- RefSeq:   NP_215485.1
- RefSeq:   NP_335433.1
- EnsemblBacteria:   EBMYCT00000002443
- EnsemblBacteria:   EBMYCT00000069860
- GeneID:   885242
- GeneID:   926594
- GenomeReviews:   AE000516_GR
- GenomeReviews:   AL123456_GR
- KEGG:   mtc:MT0998
- KEGG:   mtu:Rv0970
- TIGR:   MT0998
- TubercuList:   Rv0970
- GeneTree:   EBGT00050000017867
- HOGENOM:   HBG569077
- OMA:   AGAFWIL
- ProtClustDB:   CLSK790864

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 22888; Mature: 22888

Theoretical pI: Translated: 9.71; Mature: 9.71

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

HASH(0x15080fac)-; HASH(0x14ae9b48)-; HASH(0x15032054)-; HASH(0x14fbe0c8)-; HASH(0x1428a2b8)-; HASH(0x150eb774)-;

Cys/Met content:

1.4 %Cys     (Translated Protein)
9.5 %Met     (Translated Protein)
11.0 %Cys+Met (Translated Protein)
1.4 %Cys     (Mature Protein)
9.5 %Met     (Mature Protein)
11.0 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MIHDLMLRWVVTGLFVLTAAECGLAIIAKRRPWTLIVNHGLHFAMAVAMAVMAWPWGARV
CHHHHHHHHHHHHHHHHHHHHCCCEEEECCCCEEEEECCCHHHHHHHHHHHHHCCCCCCC
PTTGPAVFFLLAAVWFGATAVVAVRGTATRGLYGYHGLMMLATAWMYAAMNPRLLPVRSC
CCCCHHHHHHHHHHHHHHHHHEEECCCHHCCHHHHHHHHHHHHHHHHHHCCCCEEEHHHH
TEYATEPDGSMPAMDMTAMNMPPNSGSPIWFSAVNWIGTVGFAVAAVFWACRFVMERRQE
HHHCCCCCCCCCCCCCEEECCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
ATQSRLPGSIGQAMMAAGMAMLFFAMLFPV
HHHHHCCCHHHHHHHHHHHHHHHHHHHHCH
>Mature Secondary Structure
MIHDLMLRWVVTGLFVLTAAECGLAIIAKRRPWTLIVNHGLHFAMAVAMAVMAWPWGARV
CHHHHHHHHHHHHHHHHHHHHCCCEEEECCCCEEEEECCCHHHHHHHHHHHHHCCCCCCC
PTTGPAVFFLLAAVWFGATAVVAVRGTATRGLYGYHGLMMLATAWMYAAMNPRLLPVRSC
CCCCHHHHHHHHHHHHHHHHHEEECCCHHCCHHHHHHHHHHHHHHHHHHCCCCEEEHHHH
TEYATEPDGSMPAMDMTAMNMPPNSGSPIWFSAVNWIGTVGFAVAAVFWACRFVMERRQE
HHHCCCCCCCCCCCCCEEECCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
ATQSRLPGSIGQAMMAAGMAMLFFAMLFPV
HHHHHCCCHHHHHHHHHHHHHHHHHHHHCH

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 7.0

TargetDB status: NA

Availability: NA

References: 9634230; 12218036