Definition Mycobacterium bovis BCG str. Pasteur 1173P2, complete genome.
Accession NC_008769
Length 4,374,522

Click here to switch to the map view.

The map label for this gene is sigI

Identifier: 121637120

GI number: 121637120

Start: 1363376

End: 1364581

Strand: Direct

Name: sigI

Synonym: BCG_1251

Alternate gene names: NA

Gene position: 1363376-1364581 (Clockwise)

Preceding gene: 121637119

Following gene: 121637121

Centisome position: 31.17

GC content: 64.93

Gene sequence:

>1206_bases
ATGTCGCAACACGACCCGGTAAGTGCGGCCTGGCGGGCGCATCGGGCCTACCTGGTGGACCTCGCGTTTCGTATGGTAGG
TGACATCGGCGTGGCCGAAGACATGGTGCAAGAGGCATTTTCCCGCTTGCTGCGGGCTCCGGTCGGCGACATCGACGACG
AGCGTGGCTGGCTGATCGTGGTCACCAGCCGGCTGTGCCTGGATCACATCAAGTCGGCGTCGACACGCCGGGAGCGCCCG
CAGGACATCGCCGCATGGCACGACGGTGACGCCAGCGTGTCATCGGTTGACCCGGCTGACCGGGTGACTCTCGACGACGA
GGTCCGGCTGGCTTTGCTGATCATGCTCGAGCGCCTCGGCCCCGCGGAGCGGGTGGTGTTCGTGCTGCACGAGATCTTTG
GGCTGCCCTACCAGCAAATCGCCACGACGATTGGCAGCCAGGCCTCCACATGCCGGCAGCTGGCTCATCGGGCCCGTCGC
AAGATCAACGAATCGCGCATTGCGGCCAGCGTGGAGCCAGCCCAGCATCGCGTCGTCACCAGAGCTTTCATCGAAGCCTG
CTCCAACGGAGACCTGGACACCCTGCTCGAGGTGCTGGATCCGGGTGTCGCCGGCGAGATCGACGCCCGCAAAGGCGTTG
TCGTCGTGGGCGCGGATCGGGTTGGCCCGACCATCCTGCGCCACTGGAGTCACCCCGCCACCGTCCTGGTAGCCCAGCCG
GTGTGCGGTCAACCGGCGGTGCTGGCCTTTGTCAACCGAGCGCTTGCCGGCGTGTTGGCCCTGTCGATCGAGGCCGGCAA
GATCACAAAAATCCATGTCTTAGTGCAGCCCCCTGCCCTCGACCTGTATGGCCTGCTCTCACCGCGGGCCGACCGGCATT
TGCTGGCTCGGCCCGAGTTCAAGGCGATGTTCCTCGACGATCTGCTCAACGGTAGTCGCAAGCAGCTCGCTGCGCCGTTC
GCCGATGTCATCGCCTTTGCCCGCGACTGGGGATTCCGGCTGGACGAGGTGAAAGTCCCCGTCCGCTGGTGGCACGGAGA
CCACGACCACATCGTCCCGTTCTCCCACGGGGAACACGTCGTATCCCGGCTTCCCGACGCGAAGTTGTTGCACTTGCCCG
GCGAAAGTCATCTCGCTGGGCTTGGCCGTGGTGAAGAGATTTTGAGCACCCTGATGCAGATTTGGGACCGCGACCTGCGG
AAATGA

Upstream 100 bases:

>100_bases
GGGGTGCGCCGAGCGCTGAAATCGCCGGTTGCTGTCACATTCGGCGGGGCTGTCTCGTCCTTGATGTTATGAATTCCAGC
ATGGGTCGGCGGGAGGACAC

Downstream 100 bases:

>100_bases
TCGGGCGTGTGACCGAGCTCGCATGGGCGGGCCGCACTGCTTTGCATCGCCATTTGTGCCTATTGACGGCCTTAATATGA
CATGCTGTTGCCTGTGTTAG

Product: RNA polymerase sigma factor SigI

Products: NA

Alternate protein names: ECF Subfamily RNA Polymerase Sigma-24 Subunit; Sigma Factor; RNA Polymerase ECF-Subfamily Sigma Factor; ECF Subfamily RNA Polymerase Sigma-24 Factor; RNA Polymerase Sigma Factor SigJ; RNA Polymerase Sigma Factor; RNA Polymerase Sigma-70 Factor ECF Subfamily; ECF Subfamily RNA Polymerase Sigma Factor; RNA Polymerase Sigma-70 Factor; ECF-Sigma Factor; Sigma-; Sigma Factor Sigma; Alpha/Beta Hydrolase Fold; ECF-Family RNA Polymerase Sigma Factor; RNA Polymerase Sigma Factor SigI; ECF Family RNA Polymerase Sigma Factor; Sigma-70 Region 2 Domain-Containing Protein; RNA Polymerase ECF-Type Sigma Factor; AlteRNAtive RNA Polymerase Sigma Factor; Sigma-70 Family RNA Polymerase; AlteRNAtive RNA Polymerase Sigma Factor SigJ; RNA Polymerase Sigma Factor Sigma-70 Family; Sigma-70 Factor; RNA Polymerase Sigma Factor Protein; RNA Polymerase Sigma Subunit; RNA Polymerase Sigma Subunit ECF Family; RNA Polymerase Sigma-24 Subunit; RNA Polymerase Sigma-70 Factor Family; Hydrolase; Alpha/Beta Hydrolase Fold Protein; Hydrolase Alpha/Beta Hydrolase Fold Family Protein; RNA Polymerase ECF-Type Sigma Factor SigJ; RNA Polymerase Sigma-24 Factor; ECF-Type Sigma Factor; RNA Polymerase Sigma-70 ECF Type; RNA Polymerase Sigma Factor Sigma-70 Family Protein; Sigma-70 Family RNA Polymerase Sigma Factor; RNA Polymerase Sigma-70 Factor Protein; RNA Polymerase; DNA-Directed RNA Polymeracialized Sigma Subunit

Number of amino acids: Translated: 401; Mature: 400

Protein sequence:

>401_residues
MSQHDPVSAAWRAHRAYLVDLAFRMVGDIGVAEDMVQEAFSRLLRAPVGDIDDERGWLIVVTSRLCLDHIKSASTRRERP
QDIAAWHDGDASVSSVDPADRVTLDDEVRLALLIMLERLGPAERVVFVLHEIFGLPYQQIATTIGSQASTCRQLAHRARR
KINESRIAASVEPAQHRVVTRAFIEACSNGDLDTLLEVLDPGVAGEIDARKGVVVVGADRVGPTILRHWSHPATVLVAQP
VCGQPAVLAFVNRALAGVLALSIEAGKITKIHVLVQPPALDLYGLLSPRADRHLLARPEFKAMFLDDLLNGSRKQLAAPF
ADVIAFARDWGFRLDEVKVPVRWWHGDHDHIVPFSHGEHVVSRLPDAKLLHLPGESHLAGLGRGEEILSTLMQIWDRDLR
K

Sequences:

>Translated_401_residues
MSQHDPVSAAWRAHRAYLVDLAFRMVGDIGVAEDMVQEAFSRLLRAPVGDIDDERGWLIVVTSRLCLDHIKSASTRRERP
QDIAAWHDGDASVSSVDPADRVTLDDEVRLALLIMLERLGPAERVVFVLHEIFGLPYQQIATTIGSQASTCRQLAHRARR
KINESRIAASVEPAQHRVVTRAFIEACSNGDLDTLLEVLDPGVAGEIDARKGVVVVGADRVGPTILRHWSHPATVLVAQP
VCGQPAVLAFVNRALAGVLALSIEAGKITKIHVLVQPPALDLYGLLSPRADRHLLARPEFKAMFLDDLLNGSRKQLAAPF
ADVIAFARDWGFRLDEVKVPVRWWHGDHDHIVPFSHGEHVVSRLPDAKLLHLPGESHLAGLGRGEEILSTLMQIWDRDLR
K
>Mature_400_residues
SQHDPVSAAWRAHRAYLVDLAFRMVGDIGVAEDMVQEAFSRLLRAPVGDIDDERGWLIVVTSRLCLDHIKSASTRRERPQ
DIAAWHDGDASVSSVDPADRVTLDDEVRLALLIMLERLGPAERVVFVLHEIFGLPYQQIATTIGSQASTCRQLAHRARRK
INESRIAASVEPAQHRVVTRAFIEACSNGDLDTLLEVLDPGVAGEIDARKGVVVVGADRVGPTILRHWSHPATVLVAQPV
CGQPAVLAFVNRALAGVLALSIEAGKITKIHVLVQPPALDLYGLLSPRADRHLLARPEFKAMFLDDLLNGSRKQLAAPFA
DVIAFARDWGFRLDEVKVPVRWWHGDHDHIVPFSHGEHVVSRLPDAKLLHLPGESHLAGLGRGEEILSTLMQIWDRDLRK

Specific function: Unknown

COG id: COG1595

COG function: function code K; DNA-directed RNA polymerase specialized sigma subunit, sigma24 homolog

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 44305; Mature: 44174

Theoretical pI: Translated: 6.80; Mature: 6.80

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.0 %Cys     (Translated Protein)
1.5 %Met     (Translated Protein)
2.5 %Cys+Met (Translated Protein)
1.0 %Cys     (Mature Protein)
1.2 %Met     (Mature Protein)
2.2 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSQHDPVSAAWRAHRAYLVDLAFRMVGDIGVAEDMVQEAFSRLLRAPVGDIDDERGWLIV
CCCCCCHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHCCCCCCCCCCCEEEE
VTSRLCLDHIKSASTRRERPQDIAAWHDGDASVSSVDPADRVTLDDEVRLALLIMLERLG
EHHHHHHHHHHHHHHHHCCCCHHHCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHCC
PAERVVFVLHEIFGLPYQQIATTIGSQASTCRQLAHRARRKINESRIAASVEPAQHRVVT
HHHHHHHHHHHHHCCCHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHH
RAFIEACSNGDLDTLLEVLDPGVAGEIDARKGVVVVGADRVGPTILRHWSHPATVLVAQP
HHHHHHHCCCCHHHHHHHHCCCCCCCCCCCCCEEEEECCCCCHHHHHHCCCCCEEEEECC
VCGQPAVLAFVNRALAGVLALSIEAGKITKIHVLVQPPALDLYGLLSPRADRHLLARPEF
CCCCHHHHHHHHHHHHHHHHEEECCCCEEEEEEEECCCCCCHHHHCCCCCCCCCCCCCCH
KAMFLDDLLNGSRKQLAAPFADVIAFARDWGFRLDEVKVPVRWWHGDHDHIVPFSHGEHV
HHHHHHHHHCCCHHHHHCCHHHHHHHHHHCCCEECEEEEEEEEECCCCCCCCCCCCCHHH
VSRLPDAKLLHLPGESHLAGLGRGEEILSTLMQIWDRDLRK
HHHCCCCEEEECCCCHHHCCCCCCHHHHHHHHHHHHHHHCC
>Mature Secondary Structure 
SQHDPVSAAWRAHRAYLVDLAFRMVGDIGVAEDMVQEAFSRLLRAPVGDIDDERGWLIV
CCCCCHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHCCCCCCCCCCCEEEE
VTSRLCLDHIKSASTRRERPQDIAAWHDGDASVSSVDPADRVTLDDEVRLALLIMLERLG
EHHHHHHHHHHHHHHHHCCCCHHHCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHCC
PAERVVFVLHEIFGLPYQQIATTIGSQASTCRQLAHRARRKINESRIAASVEPAQHRVVT
HHHHHHHHHHHHHCCCHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHH
RAFIEACSNGDLDTLLEVLDPGVAGEIDARKGVVVVGADRVGPTILRHWSHPATVLVAQP
HHHHHHHCCCCHHHHHHHHCCCCCCCCCCCCCEEEEECCCCCHHHHHHCCCCCEEEEECC
VCGQPAVLAFVNRALAGVLALSIEAGKITKIHVLVQPPALDLYGLLSPRADRHLLARPEF
CCCCHHHHHHHHHHHHHHHHEEECCCCEEEEEEEECCCCCCHHHHCCCCCCCCCCCCCCH
KAMFLDDLLNGSRKQLAAPFADVIAFARDWGFRLDEVKVPVRWWHGDHDHIVPFSHGEHV
HHHHHHHHHCCCHHHHHCCHHHHHHHHHHCCCEECEEEEEEEEECCCCCCCCCCCCCHHH
VSRLPDAKLLHLPGESHLAGLGRGEEILSTLMQIWDRDLRK
HHHCCCCEEEECCCCHHHCCCCCCHHHHHHHHHHHHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA