The gene/protein map for NC_009565 is currently unavailable.
Definition Mycobacterium tuberculosis F11, complete genome.
Accession NC_009565
Length 4,424,435

Click here to switch to the map view.

The map label for this gene is rpoE [H]

Identifier: 148824423

GI number: 148824423

Start: 3610679

End: 3611446

Strand: Reverse

Name: rpoE [H]

Synonym: TBFG_13250

Alternate gene names: 148824423

Gene position: 3611446-3610679 (Counterclockwise)

Preceding gene: 148824427

Following gene: 148824422

Centisome position: 81.63

GC content: 61.98

Gene sequence:

>768_bases
GTGTCAACGGCGACGAGCCTGTTGGGTGAGAAGCGGTTGGCTCGCATGCTCGCACGTCCGGTGTCCGCGCCGGTGCTGTC
CGGCGACACCGCAAACGAAGGGACCCAGTTAATCAAGATGGCCGACATCGATGGTGTAACCGGTTCGGCGGGTCTGCAGC
CTGGGCCGTCTGAGGAGACAGACGAGGAGTTGACCGCGCGTTTCGAGCGCGACGCGATTCCCCTGTTGGACCAGCTGTAC
GGCGGTGCGCTGCGGATGACGCGCAATCCGGCCGACGCCGAGGACTTGCTCCAGGAGACGATGGTGAAGGCCTATGCGGG
ATTTCGTTCGTTCCGGCACGGTACCAATCTCAAGGCCTGGCTCTACCGGATACTGACCAACACCTACATCAACAGCTATC
GCAAGAAACAGCGGCAACCGGCGGAGTATCCGACCGAGCAGATCACCGATTGGCAACTGGCGTCCAACGCCGAGCATTCC
TCGACCGGGCTGCGCTCGGCTGAAGTCGAAGCGTTAGAAGCGTTGCCGGACACCGAGATCAAAGAGGCGCTGCAGGCATT
GCCGGAAGAGTTCCGGATGGCGGTCTACTACGCCGATGTCGAAGGTTTCCCCTACAAGGAGATCGCCGAGATCATGGATA
CTCCGATCGGCACCGTGATGTCGAGGCTTCATCGCGGCCGACGTCAGTTGCGCGGTCTTTTAGCCGATGTGGCCAGGGAT
CGGGGGTTTGCCAGGGGCGAGCAGGCGCACGAGGGGGTGTCGTCATGA

Upstream 100 bases:

>100_bases
CGAACACGGTTGATTGGTTCGGTTCCTGCAGCCACGTGGCTGGCCAGACCGGTGCAGACAGTGTCGGTCGCGGCCTCTAC
ATTGGGACGAGGGGAGTCTG

Downstream 100 bases:

>100_bases
GCAGCCCGGTGTCAAGCCGCCGTTTGGCGAACTTGGTCAAGGAGAGCCTGCAGGGCTCGGTGTTGGGTGGGGTCGTAAGC
GATGCCGTCTTGCCAGCGGT

Product: RNA polymerase sigma factor RpoE

Products: NA

Alternate protein names: Sigma-24 [H]

Number of amino acids: Translated: 255; Mature: 254

Protein sequence:

>255_residues
MSTATSLLGEKRLARMLARPVSAPVLSGDTANEGTQLIKMADIDGVTGSAGLQPGPSEETDEELTARFERDAIPLLDQLY
GGALRMTRNPADAEDLLQETMVKAYAGFRSFRHGTNLKAWLYRILTNTYINSYRKKQRQPAEYPTEQITDWQLASNAEHS
STGLRSAEVEALEALPDTEIKEALQALPEEFRMAVYYADVEGFPYKEIAEIMDTPIGTVMSRLHRGRRQLRGLLADVARD
RGFARGEQAHEGVSS

Sequences:

>Translated_255_residues
MSTATSLLGEKRLARMLARPVSAPVLSGDTANEGTQLIKMADIDGVTGSAGLQPGPSEETDEELTARFERDAIPLLDQLY
GGALRMTRNPADAEDLLQETMVKAYAGFRSFRHGTNLKAWLYRILTNTYINSYRKKQRQPAEYPTEQITDWQLASNAEHS
STGLRSAEVEALEALPDTEIKEALQALPEEFRMAVYYADVEGFPYKEIAEIMDTPIGTVMSRLHRGRRQLRGLLADVARD
RGFARGEQAHEGVSS
>Mature_254_residues
STATSLLGEKRLARMLARPVSAPVLSGDTANEGTQLIKMADIDGVTGSAGLQPGPSEETDEELTARFERDAIPLLDQLYG
GALRMTRNPADAEDLLQETMVKAYAGFRSFRHGTNLKAWLYRILTNTYINSYRKKQRQPAEYPTEQITDWQLASNAEHSS
TGLRSAEVEALEALPDTEIKEALQALPEEFRMAVYYADVEGFPYKEIAEIMDTPIGTVMSRLHRGRRQLRGLLADVARDR
GFARGEQAHEGVSS

Specific function: Sigma factors are initiation factors that promote the attachment of RNA polymerase to specific initiation sites and are then released. This sigma factor is involved in heat shock and oxidative stress response; it is believed to control protein processing

COG id: COG1595

COG function: function code K; DNA-directed RNA polymerase specialized sigma subunit, sigma24 homolog

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the sigma-70 factor family. ECF subfamily [H]

Homologues:

Organism=Escherichia coli, GI1788926, Length=141, Percent_Identity=36.1702127659575, Blast_Score=86, Evalue=2e-18,

Paralogues:

None

Copy number: <10 [C]

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR014284
- InterPro:   IPR014293
- InterPro:   IPR000838
- InterPro:   IPR007627
- InterPro:   IPR013249
- InterPro:   IPR013325
- InterPro:   IPR013324 [H]

Pfam domain/function: PF04542 Sigma70_r2; PF08281 Sigma70_r4_2 [H]

EC number: NA

Molecular weight: Translated: 28292; Mature: 28161

Theoretical pI: Translated: 4.96; Mature: 4.96

Prosite motif: PS01063 SIGMA70_ECF

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.0 %Cys     (Translated Protein)
3.1 %Met     (Translated Protein)
3.1 %Cys+Met (Translated Protein)
0.0 %Cys     (Mature Protein)
2.8 %Met     (Mature Protein)
2.8 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSTATSLLGEKRLARMLARPVSAPVLSGDTANEGTQLIKMADIDGVTGSAGLQPGPSEET
CCHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCHHHHHHHHCCCCCCCCCCCCCCCCCCH
DEELTARFERDAIPLLDQLYGGALRMTRNPADAEDLLQETMVKAYAGFRSFRHGTNLKAW
HHHHHHHHHHHHHHHHHHHCCCHHEECCCCCCHHHHHHHHHHHHHHHHHHHHCCCCHHHH
LYRILTNTYINSYRKKQRQPAEYPTEQITDWQLASNAEHSSTGLRSAEVEALEALPDTEI
HHHHHHHHHHHHHHHHHCCCCCCCHHHCCCHHHHCCCCHHHCCCHHHHHHHHHHCCCHHH
KEALQALPEEFRMAVYYADVEGFPYKEIAEIMDTPIGTVMSRLHRGRRQLRGLLADVARD
HHHHHHHHHHHHHHHEEECCCCCCHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHH
RGFARGEQAHEGVSS
CCCCCCHHHHCCCCC
>Mature Secondary Structure 
STATSLLGEKRLARMLARPVSAPVLSGDTANEGTQLIKMADIDGVTGSAGLQPGPSEET
CHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCHHHHHHHHCCCCCCCCCCCCCCCCCCH
DEELTARFERDAIPLLDQLYGGALRMTRNPADAEDLLQETMVKAYAGFRSFRHGTNLKAW
HHHHHHHHHHHHHHHHHHHCCCHHEECCCCCCHHHHHHHHHHHHHHHHHHHHCCCCHHHH
LYRILTNTYINSYRKKQRQPAEYPTEQITDWQLASNAEHSSTGLRSAEVEALEALPDTEI
HHHHHHHHHHHHHHHHHCCCCCCCHHHCCCHHHHCCCCHHHCCCHHHHHHHHHHCCCHHH
KEALQALPEEFRMAVYYADVEGFPYKEIAEIMDTPIGTVMSRLHRGRRQLRGLLADVARD
HHHHHHHHHHHHHHHEEECCCCCCHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHH
RGFARGEQAHEGVSS
CCCCCCHHHHCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: DNA [C]

Specific reaction: Protein + DNA = Protein-DNA [C]

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: 12788972 [H]