| Definition | Mycobacterium tuberculosis F11, complete genome. |
|---|---|
| Accession | NC_009565 |
| Length | 4,424,435 |
Click here to switch to the map view.
The map label for this gene is rpoD
Identifier: 148823893
GI number: 148823893
Start: 3029790
End: 3031376
Strand: Direct
Name: rpoD
Synonym: TBFG_12718
Alternate gene names: 148823893
Gene position: 3029790-3031376 (Clockwise)
Preceding gene: 148823892
Following gene: 148823894
Centisome position: 68.48
GC content: 66.23
Gene sequence:
>1587_bases GTGGCAGCGACCAAAGCAAGCACGGCGACCGATGAGCCGGTAAAACGCACCGCCACCAAGTCGCCCGCGGCTTCCGCGTC CGGGGCCAAGACCGGCGCCAAGCGAACAGCGGCGAAGTCCGCTAGTGGCTCCCCACCCGCGAAGCGGGCTACCAAGCCCG CGGCCCGGTCCGTCAAGCCCGCCTCGGCACCCCAGGACACTACGACCAGCACCATCCCGAAAAGGAAGACCCGCGCCGCG GCCAAATCCGCCGCCGCGAAGGCACCGTCGGCCCGCGGCCACGCGACCAAGCCACGGGCGCCCAAGGATGCCCAGCACGA AGCCGCAACGGATCCCGAGGACGCCCTGGACTCCGTCGAGGAGCTCGACGCTGAACCAGACCTCGACGTCGAGCCCGGCG AGGACCTCGACCTTGACGCCGCCGACCTCAACCTCGATGACCTCGAGGACGACGTGGCGCCGGACGCCGACGACGACCTC GACTCGGGCGACGACGAAGACCACGAAGACCTCGAAGCTGAGGCGGCCGTCGCGCCCGGCCAGACCGCCGATGACGACGA GGAGATCGCTGAACCCACCGAAAAGGACAAGGCCTCCGGTGATTTCGTCTGGGATGAAGACGAGTCGGAGGCCCTGCGTC AAGCACGCAAGGACGCCGAACTCACCGCATCCGCCGACTCGGTTCGCGCCTACCTCAAACAGATCGGCAAGGTAGCGCTG CTCAACGCCGAGGAAGAGGTCGAGCTAGCCAAGCGGATCGAGGCTGGCCTGTACGCCACGCAGCTGATGACCGAGCTTAG CGAGCGCGGCGAAAAGCTGCCTGCCGCCCAGCGCCGCGACATGATGTGGATCTGCCGCGACGGCGATCGCGCGAAAAACC ATCTGCTGGAAGCCAACCTGCGCCTGGTGGTTTCGCTAGCCAAGCGCTACACCGGCCGGGGCATGGCGTTTCTCGACCTG ATCCAGGAAGGCAACCTGGGGCTGATCCGCGCGGTGGAGAAGTTCGACTACACCAAGGGGTACAAGTTCTCCACCTACGC TACGTGGTGGATTCGCCAGGCCATCACCCGCGCCATGGCCGACCAGGCCCGCACCATCCGCATCCCGGTGCACATGGTCG AGGTGATCAACAAGCTGGGCCGCATTCAACGCGAGCTGCTGCAGGACCTGGGCCGCGAGCCCACGCCCGAGGAGCTGGCC AAAGAGATGGACATCACCCCGGAGAAGGTGCTGGAAATCCAGCAATACGCCCGCGAGCCGATCTCGTTGGACCAGACCAT CGGCGACGAGGGCGACAGCCAGCTTGGCGATTTCATCGAAGACAGCGAGGCGGTGGTGGCCGTCGACGCGGTGTCCTTCA CTTTGCTGCAGGATCAACTGCAGTCGGTGCTGGACACGCTCTCCGAGCGTGAGGCGGGCGTGGTGCGGCTACGCTTCGGC CTTACCGACGGCCAGCCGCGCACCCTTGACGAGATCGGCCAGGTCTACGGCGTGACCCGGGAACGCATCCGCCAGATCGA ATCCAAGACTATGTCGAAGTTGCGCCATCCGAGCCGCTCACAGGTCCTGCGCGACTACCTGGACTGA
Upstream 100 bases:
>100_bases TATTCACGCTGATATCAACGCCGACATTCGACATAGCAGACACTTTCGGTTACGCACGCCCAGACCCAACCGGAAGTGAG TAACGACCGAAGGGGTGTAT
Downstream 100 bases:
>100_bases GAGCGCCCGCCGAGGCGACCAACGTAGCGGGCCCCCATGTCAGCTAGCCGCACCATGGTCTCGTCCGGATCGGAGTTCGA ATCAGCCGTCGGCTACTCGC
Product: RNA polymerase sigma factor
Products: NA
Alternate protein names: Sigma-A
Number of amino acids: Translated: 528; Mature: 527
Protein sequence:
>528_residues MAATKASTATDEPVKRTATKSPAASASGAKTGAKRTAAKSASGSPPAKRATKPAARSVKPASAPQDTTTSTIPKRKTRAA AKSAAAKAPSARGHATKPRAPKDAQHEAATDPEDALDSVEELDAEPDLDVEPGEDLDLDAADLNLDDLEDDVAPDADDDL DSGDDEDHEDLEAEAAVAPGQTADDDEEIAEPTEKDKASGDFVWDEDESEALRQARKDAELTASADSVRAYLKQIGKVAL LNAEEEVELAKRIEAGLYATQLMTELSERGEKLPAAQRRDMMWICRDGDRAKNHLLEANLRLVVSLAKRYTGRGMAFLDL IQEGNLGLIRAVEKFDYTKGYKFSTYATWWIRQAITRAMADQARTIRIPVHMVEVINKLGRIQRELLQDLGREPTPEELA KEMDITPEKVLEIQQYAREPISLDQTIGDEGDSQLGDFIEDSEAVVAVDAVSFTLLQDQLQSVLDTLSEREAGVVRLRFG LTDGQPRTLDEIGQVYGVTRERIRQIESKTMSKLRHPSRSQVLRDYLD
Sequences:
>Translated_528_residues MAATKASTATDEPVKRTATKSPAASASGAKTGAKRTAAKSASGSPPAKRATKPAARSVKPASAPQDTTTSTIPKRKTRAA AKSAAAKAPSARGHATKPRAPKDAQHEAATDPEDALDSVEELDAEPDLDVEPGEDLDLDAADLNLDDLEDDVAPDADDDL DSGDDEDHEDLEAEAAVAPGQTADDDEEIAEPTEKDKASGDFVWDEDESEALRQARKDAELTASADSVRAYLKQIGKVAL LNAEEEVELAKRIEAGLYATQLMTELSERGEKLPAAQRRDMMWICRDGDRAKNHLLEANLRLVVSLAKRYTGRGMAFLDL IQEGNLGLIRAVEKFDYTKGYKFSTYATWWIRQAITRAMADQARTIRIPVHMVEVINKLGRIQRELLQDLGREPTPEELA KEMDITPEKVLEIQQYAREPISLDQTIGDEGDSQLGDFIEDSEAVVAVDAVSFTLLQDQLQSVLDTLSEREAGVVRLRFG LTDGQPRTLDEIGQVYGVTRERIRQIESKTMSKLRHPSRSQVLRDYLD >Mature_527_residues AATKASTATDEPVKRTATKSPAASASGAKTGAKRTAAKSASGSPPAKRATKPAARSVKPASAPQDTTTSTIPKRKTRAAA KSAAAKAPSARGHATKPRAPKDAQHEAATDPEDALDSVEELDAEPDLDVEPGEDLDLDAADLNLDDLEDDVAPDADDDLD SGDDEDHEDLEAEAAVAPGQTADDDEEIAEPTEKDKASGDFVWDEDESEALRQARKDAELTASADSVRAYLKQIGKVALL NAEEEVELAKRIEAGLYATQLMTELSERGEKLPAAQRRDMMWICRDGDRAKNHLLEANLRLVVSLAKRYTGRGMAFLDLI QEGNLGLIRAVEKFDYTKGYKFSTYATWWIRQAITRAMADQARTIRIPVHMVEVINKLGRIQRELLQDLGREPTPEELAK EMDITPEKVLEIQQYAREPISLDQTIGDEGDSQLGDFIEDSEAVVAVDAVSFTLLQDQLQSVLDTLSEREAGVVRLRFGL TDGQPRTLDEIGQVYGVTRERIRQIESKTMSKLRHPSRSQVLRDYLD
Specific function: Sigma factors are initiation factors that promote the attachment of RNA polymerase to specific initiation sites and are then released. This is the primary sigma factor of this bacterium
COG id: COG0568
COG function: function code K; DNA-directed RNA polymerase, sigma subunit (sigma70/sigma32)
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the sigma-70 factor family
Homologues:
Organism=Escherichia coli, GI1789448, Length=239, Percent_Identity=60.2510460251046, Blast_Score=310, Evalue=1e-85, Organism=Escherichia coli, GI1789098, Length=298, Percent_Identity=38.9261744966443, Blast_Score=191, Evalue=8e-50, Organism=Escherichia coli, GI1789871, Length=231, Percent_Identity=30.7359307359307, Blast_Score=87, Evalue=2e-18,
Paralogues:
None
Copy number: 700 (log & stationary phase) [C]
Swissprot (AC and ID): RPOD_MYCBO (P0A603)
Other databases:
- EMBL: U21133 - EMBL: BX248343 - RefSeq: NP_856368.1 - ProteinModelPortal: P0A603 - SMR: P0A603 - EnsemblBacteria: EBMYCT00000017930 - GeneID: 1091889 - GenomeReviews: BX248333_GR - KEGG: mbo:Mb2722 - GeneTree: EBGT00050000014975 - HOGENOM: HBG745096 - OMA: LMSEMAE - ProtClustDB: PRK05901 - BioCyc: MBOV233413:MB2722-MONOMER - InterPro: IPR014284 - InterPro: IPR000943 - InterPro: IPR009042 - InterPro: IPR007627 - InterPro: IPR007624 - InterPro: IPR007630 - InterPro: IPR013325 - InterPro: IPR013324 - InterPro: IPR012760 - InterPro: IPR011991 - Gene3D: G3DSA:1.10.10.10 - PRINTS: PR00046 - TIGRFAMs: TIGR02393 - TIGRFAMs: TIGR02937
Pfam domain/function: PF00140 Sigma70_r1_2; PF04542 Sigma70_r2; PF04539 Sigma70_r3; PF04545 Sigma70_r4; SSF88946 Sigma_r2; SSF88659 Sigma_r3_r4
EC number: NA
Molecular weight: Translated: 57801; Mature: 57669
Theoretical pI: Translated: 4.46; Mature: 4.46
Prosite motif: PS00715 SIGMA70_1; PS00716 SIGMA70_2; PS00867 CPSASE_2
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.2 %Cys (Translated Protein) 1.7 %Met (Translated Protein) 1.9 %Cys+Met (Translated Protein) 0.2 %Cys (Mature Protein) 1.5 %Met (Mature Protein) 1.7 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MAATKASTATDEPVKRTATKSPAASASGAKTGAKRTAAKSASGSPPAKRATKPAARSVKP CCCCCCCCCCCCHHHHHHCCCCCCCCCCCCCCHHHHHHCCCCCCCCHHHCCCCHHHCCCC ASAPQDTTTSTIPKRKTRAAAKSAAAKAPSARGHATKPRAPKDAQHEAATDPEDALDSVE CCCCCCCCCCCCCHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHH ELDAEPDLDVEPGEDLDLDAADLNLDDLEDDVAPDADDDLDSGDDEDHEDLEAEAAVAPG HCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHCCCCCCCCCCCCCCCCHHHHHHHHHCCCC QTADDDEEIAEPTEKDKASGDFVWDEDESEALRQARKDAELTASADSVRAYLKQIGKVAL CCCCCHHHHHCCCHHCCCCCCCCCCCCHHHHHHHHHHHHHHHCCHHHHHHHHHHHCCEEE LNAEEEVELAKRIEAGLYATQLMTELSERGEKLPAAQRRDMMWICRDGDRAKNHLLEANL ECCHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHCCEEEEECCCCHHHHHHHHHHH RLVVSLAKRYTGRGMAFLDLIQEGNLGLIRAVEKFDYTKGYKFSTYATWWIRQAITRAMA HHHHHHHHHHCCCCHHHHHHHHCCCCHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHH DQARTIRIPVHMVEVINKLGRIQRELLQDLGREPTPEELAKEMDITPEKVLEIQQYAREP HCCCEEECHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHCCCCHHHHHHHHHHHCCC ISLDQTIGDEGDSQLGDFIEDSEAVVAVDAVSFTLLQDQLQSVLDTLSEREAGVVRLRFG CCHHHHHCCCCCHHHHHHHCCCCCEEEEHHHHHHHHHHHHHHHHHHHHHHCCCEEEEEEC LTDGQPRTLDEIGQVYGVTRERIRQIESKTMSKLRHPSRSQVLRDYLD CCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHCC >Mature Secondary Structure AATKASTATDEPVKRTATKSPAASASGAKTGAKRTAAKSASGSPPAKRATKPAARSVKP CCCCCCCCCCCHHHHHHCCCCCCCCCCCCCCHHHHHHCCCCCCCCHHHCCCCHHHCCCC ASAPQDTTTSTIPKRKTRAAAKSAAAKAPSARGHATKPRAPKDAQHEAATDPEDALDSVE CCCCCCCCCCCCCHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHH ELDAEPDLDVEPGEDLDLDAADLNLDDLEDDVAPDADDDLDSGDDEDHEDLEAEAAVAPG HCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHCCCCCCCCCCCCCCCCHHHHHHHHHCCCC QTADDDEEIAEPTEKDKASGDFVWDEDESEALRQARKDAELTASADSVRAYLKQIGKVAL CCCCCHHHHHCCCHHCCCCCCCCCCCCHHHHHHHHHHHHHHHCCHHHHHHHHHHHCCEEE LNAEEEVELAKRIEAGLYATQLMTELSERGEKLPAAQRRDMMWICRDGDRAKNHLLEANL ECCHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHCCEEEEECCCCHHHHHHHHHHH RLVVSLAKRYTGRGMAFLDLIQEGNLGLIRAVEKFDYTKGYKFSTYATWWIRQAITRAMA HHHHHHHHHHCCCCHHHHHHHHCCCCHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHH DQARTIRIPVHMVEVINKLGRIQRELLQDLGREPTPEELAKEMDITPEKVLEIQQYAREP HCCCEEECHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHCCCCHHHHHHHHHHHCCC ISLDQTIGDEGDSQLGDFIEDSEAVVAVDAVSFTLLQDQLQSVLDTLSEREAGVVRLRFG CCHHHHHCCCCCHHHHHHHCCCCCEEEEHHHHHHHHHHHHHHHHHHHHHHCCCEEEEEEC LTDGQPRTLDEIGQVYGVTRERIRQIESKTMSKLRHPSRSQVLRDYLD CCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHCC
PDB accession: NA
Resolution: NA
Structure class: Alpha
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: DNA [C]
Specific reaction: Protein + DNA = Protein-DNA [C]
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 12788972