The gene/protein map for NC_009565 is currently unavailable.
Definition Mycobacterium tuberculosis F11, complete genome.
Accession NC_009565
Length 4,424,435

Click here to switch to the map view.

The map label for this gene is rpoD

Identifier: 148823893

GI number: 148823893

Start: 3029790

End: 3031376

Strand: Direct

Name: rpoD

Synonym: TBFG_12718

Alternate gene names: 148823893

Gene position: 3029790-3031376 (Clockwise)

Preceding gene: 148823892

Following gene: 148823894

Centisome position: 68.48

GC content: 66.23

Gene sequence:

>1587_bases
GTGGCAGCGACCAAAGCAAGCACGGCGACCGATGAGCCGGTAAAACGCACCGCCACCAAGTCGCCCGCGGCTTCCGCGTC
CGGGGCCAAGACCGGCGCCAAGCGAACAGCGGCGAAGTCCGCTAGTGGCTCCCCACCCGCGAAGCGGGCTACCAAGCCCG
CGGCCCGGTCCGTCAAGCCCGCCTCGGCACCCCAGGACACTACGACCAGCACCATCCCGAAAAGGAAGACCCGCGCCGCG
GCCAAATCCGCCGCCGCGAAGGCACCGTCGGCCCGCGGCCACGCGACCAAGCCACGGGCGCCCAAGGATGCCCAGCACGA
AGCCGCAACGGATCCCGAGGACGCCCTGGACTCCGTCGAGGAGCTCGACGCTGAACCAGACCTCGACGTCGAGCCCGGCG
AGGACCTCGACCTTGACGCCGCCGACCTCAACCTCGATGACCTCGAGGACGACGTGGCGCCGGACGCCGACGACGACCTC
GACTCGGGCGACGACGAAGACCACGAAGACCTCGAAGCTGAGGCGGCCGTCGCGCCCGGCCAGACCGCCGATGACGACGA
GGAGATCGCTGAACCCACCGAAAAGGACAAGGCCTCCGGTGATTTCGTCTGGGATGAAGACGAGTCGGAGGCCCTGCGTC
AAGCACGCAAGGACGCCGAACTCACCGCATCCGCCGACTCGGTTCGCGCCTACCTCAAACAGATCGGCAAGGTAGCGCTG
CTCAACGCCGAGGAAGAGGTCGAGCTAGCCAAGCGGATCGAGGCTGGCCTGTACGCCACGCAGCTGATGACCGAGCTTAG
CGAGCGCGGCGAAAAGCTGCCTGCCGCCCAGCGCCGCGACATGATGTGGATCTGCCGCGACGGCGATCGCGCGAAAAACC
ATCTGCTGGAAGCCAACCTGCGCCTGGTGGTTTCGCTAGCCAAGCGCTACACCGGCCGGGGCATGGCGTTTCTCGACCTG
ATCCAGGAAGGCAACCTGGGGCTGATCCGCGCGGTGGAGAAGTTCGACTACACCAAGGGGTACAAGTTCTCCACCTACGC
TACGTGGTGGATTCGCCAGGCCATCACCCGCGCCATGGCCGACCAGGCCCGCACCATCCGCATCCCGGTGCACATGGTCG
AGGTGATCAACAAGCTGGGCCGCATTCAACGCGAGCTGCTGCAGGACCTGGGCCGCGAGCCCACGCCCGAGGAGCTGGCC
AAAGAGATGGACATCACCCCGGAGAAGGTGCTGGAAATCCAGCAATACGCCCGCGAGCCGATCTCGTTGGACCAGACCAT
CGGCGACGAGGGCGACAGCCAGCTTGGCGATTTCATCGAAGACAGCGAGGCGGTGGTGGCCGTCGACGCGGTGTCCTTCA
CTTTGCTGCAGGATCAACTGCAGTCGGTGCTGGACACGCTCTCCGAGCGTGAGGCGGGCGTGGTGCGGCTACGCTTCGGC
CTTACCGACGGCCAGCCGCGCACCCTTGACGAGATCGGCCAGGTCTACGGCGTGACCCGGGAACGCATCCGCCAGATCGA
ATCCAAGACTATGTCGAAGTTGCGCCATCCGAGCCGCTCACAGGTCCTGCGCGACTACCTGGACTGA

Upstream 100 bases:

>100_bases
TATTCACGCTGATATCAACGCCGACATTCGACATAGCAGACACTTTCGGTTACGCACGCCCAGACCCAACCGGAAGTGAG
TAACGACCGAAGGGGTGTAT

Downstream 100 bases:

>100_bases
GAGCGCCCGCCGAGGCGACCAACGTAGCGGGCCCCCATGTCAGCTAGCCGCACCATGGTCTCGTCCGGATCGGAGTTCGA
ATCAGCCGTCGGCTACTCGC

Product: RNA polymerase sigma factor

Products: NA

Alternate protein names: Sigma-A

Number of amino acids: Translated: 528; Mature: 527

Protein sequence:

>528_residues
MAATKASTATDEPVKRTATKSPAASASGAKTGAKRTAAKSASGSPPAKRATKPAARSVKPASAPQDTTTSTIPKRKTRAA
AKSAAAKAPSARGHATKPRAPKDAQHEAATDPEDALDSVEELDAEPDLDVEPGEDLDLDAADLNLDDLEDDVAPDADDDL
DSGDDEDHEDLEAEAAVAPGQTADDDEEIAEPTEKDKASGDFVWDEDESEALRQARKDAELTASADSVRAYLKQIGKVAL
LNAEEEVELAKRIEAGLYATQLMTELSERGEKLPAAQRRDMMWICRDGDRAKNHLLEANLRLVVSLAKRYTGRGMAFLDL
IQEGNLGLIRAVEKFDYTKGYKFSTYATWWIRQAITRAMADQARTIRIPVHMVEVINKLGRIQRELLQDLGREPTPEELA
KEMDITPEKVLEIQQYAREPISLDQTIGDEGDSQLGDFIEDSEAVVAVDAVSFTLLQDQLQSVLDTLSEREAGVVRLRFG
LTDGQPRTLDEIGQVYGVTRERIRQIESKTMSKLRHPSRSQVLRDYLD

Sequences:

>Translated_528_residues
MAATKASTATDEPVKRTATKSPAASASGAKTGAKRTAAKSASGSPPAKRATKPAARSVKPASAPQDTTTSTIPKRKTRAA
AKSAAAKAPSARGHATKPRAPKDAQHEAATDPEDALDSVEELDAEPDLDVEPGEDLDLDAADLNLDDLEDDVAPDADDDL
DSGDDEDHEDLEAEAAVAPGQTADDDEEIAEPTEKDKASGDFVWDEDESEALRQARKDAELTASADSVRAYLKQIGKVAL
LNAEEEVELAKRIEAGLYATQLMTELSERGEKLPAAQRRDMMWICRDGDRAKNHLLEANLRLVVSLAKRYTGRGMAFLDL
IQEGNLGLIRAVEKFDYTKGYKFSTYATWWIRQAITRAMADQARTIRIPVHMVEVINKLGRIQRELLQDLGREPTPEELA
KEMDITPEKVLEIQQYAREPISLDQTIGDEGDSQLGDFIEDSEAVVAVDAVSFTLLQDQLQSVLDTLSEREAGVVRLRFG
LTDGQPRTLDEIGQVYGVTRERIRQIESKTMSKLRHPSRSQVLRDYLD
>Mature_527_residues
AATKASTATDEPVKRTATKSPAASASGAKTGAKRTAAKSASGSPPAKRATKPAARSVKPASAPQDTTTSTIPKRKTRAAA
KSAAAKAPSARGHATKPRAPKDAQHEAATDPEDALDSVEELDAEPDLDVEPGEDLDLDAADLNLDDLEDDVAPDADDDLD
SGDDEDHEDLEAEAAVAPGQTADDDEEIAEPTEKDKASGDFVWDEDESEALRQARKDAELTASADSVRAYLKQIGKVALL
NAEEEVELAKRIEAGLYATQLMTELSERGEKLPAAQRRDMMWICRDGDRAKNHLLEANLRLVVSLAKRYTGRGMAFLDLI
QEGNLGLIRAVEKFDYTKGYKFSTYATWWIRQAITRAMADQARTIRIPVHMVEVINKLGRIQRELLQDLGREPTPEELAK
EMDITPEKVLEIQQYAREPISLDQTIGDEGDSQLGDFIEDSEAVVAVDAVSFTLLQDQLQSVLDTLSEREAGVVRLRFGL
TDGQPRTLDEIGQVYGVTRERIRQIESKTMSKLRHPSRSQVLRDYLD

Specific function: Sigma factors are initiation factors that promote the attachment of RNA polymerase to specific initiation sites and are then released. This is the primary sigma factor of this bacterium

COG id: COG0568

COG function: function code K; DNA-directed RNA polymerase, sigma subunit (sigma70/sigma32)

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the sigma-70 factor family

Homologues:

Organism=Escherichia coli, GI1789448, Length=239, Percent_Identity=60.2510460251046, Blast_Score=310, Evalue=1e-85,
Organism=Escherichia coli, GI1789098, Length=298, Percent_Identity=38.9261744966443, Blast_Score=191, Evalue=8e-50,
Organism=Escherichia coli, GI1789871, Length=231, Percent_Identity=30.7359307359307, Blast_Score=87, Evalue=2e-18,

Paralogues:

None

Copy number: 700 (log & stationary phase) [C]

Swissprot (AC and ID): RPOD_MYCBO (P0A603)

Other databases:

- EMBL:   U21133
- EMBL:   BX248343
- RefSeq:   NP_856368.1
- ProteinModelPortal:   P0A603
- SMR:   P0A603
- EnsemblBacteria:   EBMYCT00000017930
- GeneID:   1091889
- GenomeReviews:   BX248333_GR
- KEGG:   mbo:Mb2722
- GeneTree:   EBGT00050000014975
- HOGENOM:   HBG745096
- OMA:   LMSEMAE
- ProtClustDB:   PRK05901
- BioCyc:   MBOV233413:MB2722-MONOMER
- InterPro:   IPR014284
- InterPro:   IPR000943
- InterPro:   IPR009042
- InterPro:   IPR007627
- InterPro:   IPR007624
- InterPro:   IPR007630
- InterPro:   IPR013325
- InterPro:   IPR013324
- InterPro:   IPR012760
- InterPro:   IPR011991
- Gene3D:   G3DSA:1.10.10.10
- PRINTS:   PR00046
- TIGRFAMs:   TIGR02393
- TIGRFAMs:   TIGR02937

Pfam domain/function: PF00140 Sigma70_r1_2; PF04542 Sigma70_r2; PF04539 Sigma70_r3; PF04545 Sigma70_r4; SSF88946 Sigma_r2; SSF88659 Sigma_r3_r4

EC number: NA

Molecular weight: Translated: 57801; Mature: 57669

Theoretical pI: Translated: 4.46; Mature: 4.46

Prosite motif: PS00715 SIGMA70_1; PS00716 SIGMA70_2; PS00867 CPSASE_2

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.2 %Cys     (Translated Protein)
1.7 %Met     (Translated Protein)
1.9 %Cys+Met (Translated Protein)
0.2 %Cys     (Mature Protein)
1.5 %Met     (Mature Protein)
1.7 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MAATKASTATDEPVKRTATKSPAASASGAKTGAKRTAAKSASGSPPAKRATKPAARSVKP
CCCCCCCCCCCCHHHHHHCCCCCCCCCCCCCCHHHHHHCCCCCCCCHHHCCCCHHHCCCC
ASAPQDTTTSTIPKRKTRAAAKSAAAKAPSARGHATKPRAPKDAQHEAATDPEDALDSVE
CCCCCCCCCCCCCHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHH
ELDAEPDLDVEPGEDLDLDAADLNLDDLEDDVAPDADDDLDSGDDEDHEDLEAEAAVAPG
HCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHCCCCCCCCCCCCCCCCHHHHHHHHHCCCC
QTADDDEEIAEPTEKDKASGDFVWDEDESEALRQARKDAELTASADSVRAYLKQIGKVAL
CCCCCHHHHHCCCHHCCCCCCCCCCCCHHHHHHHHHHHHHHHCCHHHHHHHHHHHCCEEE
LNAEEEVELAKRIEAGLYATQLMTELSERGEKLPAAQRRDMMWICRDGDRAKNHLLEANL
ECCHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHCCEEEEECCCCHHHHHHHHHHH
RLVVSLAKRYTGRGMAFLDLIQEGNLGLIRAVEKFDYTKGYKFSTYATWWIRQAITRAMA
HHHHHHHHHHCCCCHHHHHHHHCCCCHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHH
DQARTIRIPVHMVEVINKLGRIQRELLQDLGREPTPEELAKEMDITPEKVLEIQQYAREP
HCCCEEECHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHCCCCHHHHHHHHHHHCCC
ISLDQTIGDEGDSQLGDFIEDSEAVVAVDAVSFTLLQDQLQSVLDTLSEREAGVVRLRFG
CCHHHHHCCCCCHHHHHHHCCCCCEEEEHHHHHHHHHHHHHHHHHHHHHHCCCEEEEEEC
LTDGQPRTLDEIGQVYGVTRERIRQIESKTMSKLRHPSRSQVLRDYLD
CCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHCC
>Mature Secondary Structure 
AATKASTATDEPVKRTATKSPAASASGAKTGAKRTAAKSASGSPPAKRATKPAARSVKP
CCCCCCCCCCCHHHHHHCCCCCCCCCCCCCCHHHHHHCCCCCCCCHHHCCCCHHHCCCC
ASAPQDTTTSTIPKRKTRAAAKSAAAKAPSARGHATKPRAPKDAQHEAATDPEDALDSVE
CCCCCCCCCCCCCHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHH
ELDAEPDLDVEPGEDLDLDAADLNLDDLEDDVAPDADDDLDSGDDEDHEDLEAEAAVAPG
HCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHCCCCCCCCCCCCCCCCHHHHHHHHHCCCC
QTADDDEEIAEPTEKDKASGDFVWDEDESEALRQARKDAELTASADSVRAYLKQIGKVAL
CCCCCHHHHHCCCHHCCCCCCCCCCCCHHHHHHHHHHHHHHHCCHHHHHHHHHHHCCEEE
LNAEEEVELAKRIEAGLYATQLMTELSERGEKLPAAQRRDMMWICRDGDRAKNHLLEANL
ECCHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHCCEEEEECCCCHHHHHHHHHHH
RLVVSLAKRYTGRGMAFLDLIQEGNLGLIRAVEKFDYTKGYKFSTYATWWIRQAITRAMA
HHHHHHHHHHCCCCHHHHHHHHCCCCHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHH
DQARTIRIPVHMVEVINKLGRIQRELLQDLGREPTPEELAKEMDITPEKVLEIQQYAREP
HCCCEEECHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHCCCCHHHHHHHHHHHCCC
ISLDQTIGDEGDSQLGDFIEDSEAVVAVDAVSFTLLQDQLQSVLDTLSEREAGVVRLRFG
CCHHHHHCCCCCHHHHHHHCCCCCEEEEHHHHHHHHHHHHHHHHHHHHHHCCCEEEEEEC
LTDGQPRTLDEIGQVYGVTRERIRQIESKTMSKLRHPSRSQVLRDYLD
CCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Alpha

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: DNA [C]

Specific reaction: Protein + DNA = Protein-DNA [C]

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 12788972