| Definition | Shigella boydii Sb227, complete genome. |
|---|---|
| Accession | NC_007613 |
| Length | 4,519,823 |
Click here to switch to the map view.
The map label for this gene is rpoS [H]
Identifier: 82545186
GI number: 82545186
Start: 2785680
End: 2786675
Strand: Direct
Name: rpoS [H]
Synonym: SBO_2779
Alternate gene names: 82545186
Gene position: 2785680-2786675 (Clockwise)
Preceding gene: 82545185
Following gene: 82545192
Centisome position: 61.63
GC content: 51.91
Gene sequence:
>996_bases ATGAGTCAGAATACGCTGAAAGTTCATGATTTAAATGAAGATGCGGAATTTGATGAGAACGGAGTTGAGGTTTTTGACGA AAAGGCCTTAGTAGAAGAGGAACCCAGTGATAACGATTTGGCCGAAGAGGAACTGTTATCGCAGGGAGCCACACAGCGAG TGTTGGACGCGACTCAGCTTTACCTTGGTGAGATTGGTTATTCACCACTGTTAACGGCCGAAGAAGAAGAAGTTTATTTT GCGCGTCGCGCACTGCGTGGAGATGTCGCCTCTCGCCGCCGGATGATCGAGAGTAACTTGCGTCTGGTGGTAAAAATTGC CCGCCGTTATGGCAATCGTGGTCTGGCGTTGCTGGACCTTATCGAAGAGGGCAACCTGGGGCTGATCCGCGCGGTAGAGA AGTTTGACCCGGAACGTGGTTTCCGCTTCTCAACATACGCAACCTGGTGGATTCGCCAGACGATTGAACGGGCGATTATG AACCAAACCCGTACTATTCGTTTGCCGATTCACATCGTAAAGGAGCTGAACGTTTACCTGCGAACCGCACGTGAGTTGTC CCATAAGCTGGACCATGAACCAAGTGCGGAAGAGATCGCAGAGCAACTGGATAAGCCAGTTGATGACGTCAGCCGTATGC TTCGTCTTAACGAGCGCATTACCTCGGTAGACACCCCGCTGGGTGGTGATTCCGAAAAAGCGTTGCTGGACATCCTGGCC GATGAAAAAGAGAACGGTCCGGAAGATACCACGCAAGATGACGATATGAAGCAGAGCATCGTCAAATGGCTGTTCGAGCT GAACGCCAAACAGCGTGAAGTGCTGGCACGTCGATTCGGTTTGCTGGGGTACGAAGCGGCAACACTGGAAGATGTAGGTC GTGAAATTGGCCTCACCCGTGAACGTGTTCGCCAGATTCAGGTTGAAGGCCTGCGCCGTTTGCGTGAAATCCTGCAAACG CAGGGGCTGAATATCGAAGCGCTGTTCCGCGAGTAA
Upstream 100 bases:
>100_bases AATCCGTAAACCCGCTGCGTTATTTGCCGCAGCGATAAATCGGCGGAACCAGGCTTTTGCTTGAATGTTCCGTCAAGGGA TCACGGGTAGGAGCCACCTT
Downstream 100 bases:
>100_bases GTAAGCATCTGTCAGAAAGGCCAGTCTCAAGCGAGGCTGGCCTTTTCTGTGCACAATAAAAGGTCCGATGCCCATCGGAC CTTTTTATTAAGGTCAAATT
Product: RNA polymerase sigma factor RpoS
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 331; Mature: 330
Protein sequence:
>331_residues MSQNTLKVHDLNEDAEFDENGVEVFDEKALVEEEPSDNDLAEEELLSQGATQRVLDATQLYLGEIGYSPLLTAEEEEVYF ARRALRGDVASRRRMIESNLRLVVKIARRYGNRGLALLDLIEEGNLGLIRAVEKFDPERGFRFSTYATWWIRQTIERAIM NQTRTIRLPIHIVKELNVYLRTARELSHKLDHEPSAEEIAEQLDKPVDDVSRMLRLNERITSVDTPLGGDSEKALLDILA DEKENGPEDTTQDDDMKQSIVKWLFELNAKQREVLARRFGLLGYEAATLEDVGREIGLTRERVRQIQVEGLRRLREILQT QGLNIEALFRE
Sequences:
>Translated_331_residues MSQNTLKVHDLNEDAEFDENGVEVFDEKALVEEEPSDNDLAEEELLSQGATQRVLDATQLYLGEIGYSPLLTAEEEEVYF ARRALRGDVASRRRMIESNLRLVVKIARRYGNRGLALLDLIEEGNLGLIRAVEKFDPERGFRFSTYATWWIRQTIERAIM NQTRTIRLPIHIVKELNVYLRTARELSHKLDHEPSAEEIAEQLDKPVDDVSRMLRLNERITSVDTPLGGDSEKALLDILA DEKENGPEDTTQDDDMKQSIVKWLFELNAKQREVLARRFGLLGYEAATLEDVGREIGLTRERVRQIQVEGLRRLREILQT QGLNIEALFRE >Mature_330_residues SQNTLKVHDLNEDAEFDENGVEVFDEKALVEEEPSDNDLAEEELLSQGATQRVLDATQLYLGEIGYSPLLTAEEEEVYFA RRALRGDVASRRRMIESNLRLVVKIARRYGNRGLALLDLIEEGNLGLIRAVEKFDPERGFRFSTYATWWIRQTIERAIMN QTRTIRLPIHIVKELNVYLRTARELSHKLDHEPSAEEIAEQLDKPVDDVSRMLRLNERITSVDTPLGGDSEKALLDILAD EKENGPEDTTQDDDMKQSIVKWLFELNAKQREVLARRFGLLGYEAATLEDVGREIGLTRERVRQIQVEGLRRLREILQTQ GLNIEALFRE
Specific function: Sigma factors are initiation factors that promote the attachment of RNA polymerase to specific initiation sites and are then released. This sigma factor is required for the normal expression of the enterotoxin, yst, in the stationary phase [H]
COG id: COG0568
COG function: function code K; DNA-directed RNA polymerase, sigma subunit (sigma70/sigma32)
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the sigma-70 factor family [H]
Homologues:
Organism=Escherichia coli, GI1789098, Length=331, Percent_Identity=99.3957703927493, Blast_Score=653, Evalue=0.0, Organism=Escherichia coli, GI1789448, Length=237, Percent_Identity=42.6160337552743, Blast_Score=207, Evalue=6e-55, Organism=Escherichia coli, GI1789871, Length=268, Percent_Identity=26.4925373134328, Blast_Score=94, Evalue=2e-20,
Paralogues:
None
Copy number: <10 (log phase) 250 (stationary phase) [C]
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR014284 - InterPro: IPR000943 - InterPro: IPR009042 - InterPro: IPR007627 - InterPro: IPR007624 - InterPro: IPR007630 - InterPro: IPR013325 - InterPro: IPR013324 - InterPro: IPR012761 - InterPro: IPR011991 [H]
Pfam domain/function: PF00140 Sigma70_r1_2; PF04542 Sigma70_r2; PF04539 Sigma70_r3; PF04545 Sigma70_r4 [H]
EC number: NA
Molecular weight: Translated: 38103; Mature: 37971
Theoretical pI: Translated: 4.53; Mature: 4.53
Prosite motif: PS00715 SIGMA70_1 ; PS00716 SIGMA70_2
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.0 %Cys (Translated Protein) 1.5 %Met (Translated Protein) 1.5 %Cys+Met (Translated Protein) 0.0 %Cys (Mature Protein) 1.2 %Met (Mature Protein) 1.2 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MSQNTLKVHDLNEDAEFDENGVEVFDEKALVEEEPSDNDLAEEELLSQGATQRVLDATQL CCCCCEEEEECCCCCCCCCCCHHHHHHHHHHCCCCCCCCHHHHHHHHCCHHHHHHHHHHH YLGEIGYSPLLTAEEEEVYFARRALRGDVASRRRMIESNLRLVVKIARRYGNRGLALLDL HHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEHHHH IEEGNLGLIRAVEKFDPERGFRFSTYATWWIRQTIERAIMNQTRTIRLPIHIVKELNVYL HHCCCCHHHHHHHHCCCCCCCEEHHHHHHHHHHHHHHHHHCCCCEEEHHHHHHHHHHHHH RTARELSHKLDHEPSAEEIAEQLDKPVDDVSRMLRLNERITSVDTPLGGDSEKALLDILA HHHHHHHHHCCCCCCHHHHHHHHCCCHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHH DEKENGPEDTTQDDDMKQSIVKWLFELNAKQREVLARRFGLLGYEAATLEDVGREIGLTR CCCCCCCCCCCCCHHHHHHHHHHHHHCCCHHHHHHHHHHHHCCCCHHHHHHHHHHHCCCH ERVRQIQVEGLRRLREILQTQGLNIEALFRE HHHHHHHHHHHHHHHHHHHHCCCCEEEECCC >Mature Secondary Structure SQNTLKVHDLNEDAEFDENGVEVFDEKALVEEEPSDNDLAEEELLSQGATQRVLDATQL CCCCEEEEECCCCCCCCCCCHHHHHHHHHHCCCCCCCCHHHHHHHHCCHHHHHHHHHHH YLGEIGYSPLLTAEEEEVYFARRALRGDVASRRRMIESNLRLVVKIARRYGNRGLALLDL HHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEHHHH IEEGNLGLIRAVEKFDPERGFRFSTYATWWIRQTIERAIMNQTRTIRLPIHIVKELNVYL HHCCCCHHHHHHHHCCCCCCCEEHHHHHHHHHHHHHHHHHCCCCEEEHHHHHHHHHHHHH RTARELSHKLDHEPSAEEIAEQLDKPVDDVSRMLRLNERITSVDTPLGGDSEKALLDILA HHHHHHHHHCCCCCCHHHHHHHHCCCHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHH DEKENGPEDTTQDDDMKQSIVKWLFELNAKQREVLARRFGLLGYEAATLEDVGREIGLTR CCCCCCCCCCCCCHHHHHHHHHHHHHCCCHHHHHHHHHHHHCCCCHHHHHHHHHHHCCCH ERVRQIQVEGLRRLREILQTQGLNIEALFRE HHHHHHHHHHHHHHHHHHHHCCCCEEEECCC
PDB accession: NA
Resolution: NA
Structure class: Alpha
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: DNA [C]
Specific reaction: Protein + DNA = Protein-DNA [C]
General reaction: NA
Inhibitor: NA
Structure determination priority: 10.0
TargetDB status: NA
Availability: NA
References: 7729893 [H]