The gene/protein map for NC_011004 is currently unavailable.
Definition Rhodopseudomonas palustris TIE-1 chromosome, complete genome.
Accession NC_011004
Length 5,744,041

Click here to switch to the map view.

The map label for this gene is rpoH [H]

Identifier: 192288802

GI number: 192288802

Start: 394333

End: 395232

Strand: Reverse

Name: rpoH [H]

Synonym: Rpal_0371

Alternate gene names: 192288802

Gene position: 395232-394333 (Counterclockwise)

Preceding gene: 192288803

Following gene: 192288799

Centisome position: 6.88

GC content: 65.0

Gene sequence:

>900_bases
ATGGCCCGTGCTGCTACTCTCCCGATTCTCAACGGAGAATCCGGCCTTGCTCGCTACCTTGCGGAAATCCGCAAGTTTCC
GATGCTCGAGCCTCAGCAAGAGTACATGCTCGCCAAGCGCTGGCGCGAACACGGTGATCGCGACGCGGCGCATCAACTCG
TCACCAGCCATCTTCGCCTCGTCGCCAAAATCGCGATGGGCTACCGCGGCTATGGCCTGCCGATCTCCGAGGTCGTCTCG
GAAGGCAACGTCGGCCTGATGCAGGCGGTGAAGCGGTTCGAACCCGAGAAGGGCTTCCGCCTCGCCACCTACGCGATGTG
GTGGATCAAGGCGTCGATTCAAGAGTACATCCTGCGTTCGTGGTCACTCGTGAAGATGGGTACCACCGCGAACCAGAAGA
AGCTGTTCTTCAACCTGCGCAAGGCGAAGAGCAAGATCTCGGCGCTGGACGAGGGCGATCTGCATCCCGACCAGGTCAAG
CTGATCGCCACCCGGCTCGGGGTGACTGAGCAGGACGTGGTCGACATGAATCGCCGCCTCGGCGGCGACGCTTCGCTCAA
CGCGCCGATCCGCGACGACGGCGAGCCGGGCGAATGGCAGGACTGGCTGGTCGATCAGTCGCCGAGCCAGGAAGCGGTGA
TGGCCGAGCACGAAGAGCTCGACCAGCGCCGGGCCGCGCTCAACGGCGCGATCCAGGTGCTGAACCCGCGCGAACGGCGG
ATCTTCGAGGCCCGCCGCCTCGCCGACGAGCCGATGACGCTTGAAGACCTCGCCTCCGAATTCGGCGTGTCGCGCGAGCG
CGTGCGCCAGATCGAAGTGCGGGCGTTCGAGAAGGTGCAGAGCGCCGTCAAGGGCACCATCGCCCGCCAGGAACAGGCGG
CGCTGGAAGCCGCGCACTGA

Upstream 100 bases:

>100_bases
AGCCAACGCGGAACCTTCGCAGGCCGGTCGGCTTTGACACAGCGGCCCGTCTGCCTGGCCGCCCGCTATCGGGGGCCTGA
AACCAATTGGAGGGCGCTGA

Downstream 100 bases:

>100_bases
TCGATAGACACAGCTGATGACGTCGAACCCCGCCCTCACAGGCGGGGTTTTTGTTTGGTCGCTCACGCACCGCCATCGCG
CCCAGCGTCGTGCGGGCATC

Product: RNA polymerase factor sigma-32

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 299; Mature: 298

Protein sequence:

>299_residues
MARAATLPILNGESGLARYLAEIRKFPMLEPQQEYMLAKRWREHGDRDAAHQLVTSHLRLVAKIAMGYRGYGLPISEVVS
EGNVGLMQAVKRFEPEKGFRLATYAMWWIKASIQEYILRSWSLVKMGTTANQKKLFFNLRKAKSKISALDEGDLHPDQVK
LIATRLGVTEQDVVDMNRRLGGDASLNAPIRDDGEPGEWQDWLVDQSPSQEAVMAEHEELDQRRAALNGAIQVLNPRERR
IFEARRLADEPMTLEDLASEFGVSRERVRQIEVRAFEKVQSAVKGTIARQEQAALEAAH

Sequences:

>Translated_299_residues
MARAATLPILNGESGLARYLAEIRKFPMLEPQQEYMLAKRWREHGDRDAAHQLVTSHLRLVAKIAMGYRGYGLPISEVVS
EGNVGLMQAVKRFEPEKGFRLATYAMWWIKASIQEYILRSWSLVKMGTTANQKKLFFNLRKAKSKISALDEGDLHPDQVK
LIATRLGVTEQDVVDMNRRLGGDASLNAPIRDDGEPGEWQDWLVDQSPSQEAVMAEHEELDQRRAALNGAIQVLNPRERR
IFEARRLADEPMTLEDLASEFGVSRERVRQIEVRAFEKVQSAVKGTIARQEQAALEAAH
>Mature_298_residues
ARAATLPILNGESGLARYLAEIRKFPMLEPQQEYMLAKRWREHGDRDAAHQLVTSHLRLVAKIAMGYRGYGLPISEVVSE
GNVGLMQAVKRFEPEKGFRLATYAMWWIKASIQEYILRSWSLVKMGTTANQKKLFFNLRKAKSKISALDEGDLHPDQVKL
IATRLGVTEQDVVDMNRRLGGDASLNAPIRDDGEPGEWQDWLVDQSPSQEAVMAEHEELDQRRAALNGAIQVLNPRERRI
FEARRLADEPMTLEDLASEFGVSRERVRQIEVRAFEKVQSAVKGTIARQEQAALEAAH

Specific function: Sigma factors are initiation factors that promote the attachment of RNA polymerase to specific initiation sites and are then released. This sigma factor is responsible for the expression of heat shock promoters [H]

COG id: COG0568

COG function: function code K; DNA-directed RNA polymerase, sigma subunit (sigma70/sigma32)

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the sigma-70 factor family. Sigma-32 subfamily [H]

Homologues:

Organism=Escherichia coli, GI1789871, Length=289, Percent_Identity=40.1384083044983, Blast_Score=194, Evalue=5e-51,
Organism=Escherichia coli, GI1789098, Length=269, Percent_Identity=32.7137546468402, Blast_Score=123, Evalue=1e-29,
Organism=Escherichia coli, GI1789448, Length=249, Percent_Identity=31.3253012048193, Blast_Score=96, Evalue=4e-21,

Paralogues:

None

Copy number: <10 [C]

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR014284
- InterPro:   IPR000943
- InterPro:   IPR009042
- InterPro:   IPR007627
- InterPro:   IPR007630
- InterPro:   IPR013325
- InterPro:   IPR013324
- InterPro:   IPR012759
- InterPro:   IPR011991 [H]

Pfam domain/function: PF00140 Sigma70_r1_2; PF04542 Sigma70_r2; PF04545 Sigma70_r4 [H]

EC number: NA

Molecular weight: Translated: 33874; Mature: 33743

Theoretical pI: Translated: 7.91; Mature: 7.91

Prosite motif: PS00715 SIGMA70_1 ; PS00716 SIGMA70_2

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.0 %Cys     (Translated Protein)
3.3 %Met     (Translated Protein)
3.3 %Cys+Met (Translated Protein)
0.0 %Cys     (Mature Protein)
3.0 %Met     (Mature Protein)
3.0 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MARAATLPILNGESGLARYLAEIRKFPMLEPQQEYMLAKRWREHGDRDAAHQLVTSHLRL
CCCCCCCCEECCCHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHCCCHHHHHHHHHHHHHH
VAKIAMGYRGYGLPISEVVSEGNVGLMQAVKRFEPEKGFRLATYAMWWIKASIQEYILRS
HHHHHHCCCCCCCCHHHHHCCCCHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHHC
WSLVKMGTTANQKKLFFNLRKAKSKISALDEGDLHPDQVKLIATRLGVTEQDVVDMNRRL
CHHEEECCCCCHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHCCCHHHHHHHHHHC
GGDASLNAPIRDDGEPGEWQDWLVDQSPSQEAVMAEHEELDQRRAALNGAIQVLNPRERR
CCCCCCCCCCCCCCCCCCHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHH
IFEARRLADEPMTLEDLASEFGVSRERVRQIEVRAFEKVQSAVKGTIARQEQAALEAAH
HHHHHHHCCCCCCHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCC
>Mature Secondary Structure 
ARAATLPILNGESGLARYLAEIRKFPMLEPQQEYMLAKRWREHGDRDAAHQLVTSHLRL
CCCCCCCEECCCHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHCCCHHHHHHHHHHHHHH
VAKIAMGYRGYGLPISEVVSEGNVGLMQAVKRFEPEKGFRLATYAMWWIKASIQEYILRS
HHHHHHCCCCCCCCHHHHHCCCCHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHHC
WSLVKMGTTANQKKLFFNLRKAKSKISALDEGDLHPDQVKLIATRLGVTEQDVVDMNRRL
CHHEEECCCCCHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHCCCHHHHHHHHHHC
GGDASLNAPIRDDGEPGEWQDWLVDQSPSQEAVMAEHEELDQRRAALNGAIQVLNPRERR
CCCCCCCCCCCCCCCCCCHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHH
IFEARRLADEPMTLEDLASEFGVSRERVRQIEVRAFEKVQSAVKGTIARQEQAALEAAH
HHHHHHHCCCCCCHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: DNA [C]

Specific reaction: Protein + DNA = Protein-DNA [C]

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: 7501460 [H]