| Definition | Mesorhizobium sp. BNC1, complete genome. |
|---|---|
| Accession | NC_008254 |
| Length | 4,412,446 |
Click here to switch to the map view.
The map label for this gene is rpoN [H]
Identifier: 110635992
GI number: 110635992
Start: 3956497
End: 3957978
Strand: Reverse
Name: rpoN [H]
Synonym: Meso_3667
Alternate gene names: 110635992
Gene position: 3957978-3956497 (Counterclockwise)
Preceding gene: 110635993
Following gene: 110635991
Centisome position: 89.7
GC content: 61.54
Gene sequence:
>1482_bases ATGGCGCTTTCAACCGGCATACAGTTGCGGCAGTCCCAATCGCTGGTCATGACGCCCCAGCTGCTGCAGTCTATCCGGCT GCTGCAGCTGACACATATCGAGTTGGAGCTGTTCATATCCGAGGAGATCGAGCGCAATCCGCTCCTCGATCTTGTCGATG CGAGCGAGGAGGTGCCCGCAAGCGTCCTTGAGGAGAGATTTGCCTCGCCGGACAGCGCCGCGGATATTGCCGAGCGGCTG GACACCTCGCCCGAAGATCTGTTTCCAGATGACCCGGACGTGCGGGACACAATAGGGCCGGATCTCATGGCCCAGTGGCG CTCCGCCGCCGGAAATGGGCTCGTCGCGACGGGCGAGGATTGGAATCTGGAGGAGACGACGGCCGCGCCGGCTACCTTGC GCGACCATGTTCGCGAGCAGATCGTTCTCGCCTTTCCCGATCCGGTCTTGAAGCTGATCGCCGAGGAGCTGCTGGATGGA CTGGACGATGCCGGCTATTTCACGGGCGACCTGAACGAGATCGCCGAACGCTTGGCTGCCGAGACGGTGCTGGTGGAGCG GGTGCTTTCGATCTGCCAGACCTTTGATCCCCCCGGCCTGTTCGCCCGCACGCTTGCCGAATGCCTTGCGCTGCAATTGA AGGCGCGGGATCGTCTGGATCCTGCCATGCAGGCGATGCTTTCGCGTCTTGATCTGCTTTCAAGGCGCGATTTTGCTTCT TTGAAGAAAGTCTGCGGCGTGGACGAGGAGGACCTCGTGGAGATGCTGGCGGAAATCCGCTCGCTCGATCCCAAGCCCGG CACGGCCTTCTCGTCGGCACCCGCCGAACCTGTCCTGCCGGATGTGATCGTGCGGCCCTCCGCCGGGGGAGCATGGGCGA TCGAGCTCAATCCGGAAGTGCTGCCACGCGTGCTCGTTAACGAGACATATTTCACGGCCGTTTCCACGCGGGCCGGCAAA GAGGAGAAAGCCTTTCTTTCCGAGTGCCTTCAAAGTGCCAACTGGCTGACTCGCAGCCTGGAGCAGCGGGCAAGGACCAT CCTGAAAGTTGCCTCCGAGATCGTGCGCCAGCAGGATGCGTTTTTCGTGAATGGCGTTCGGCACCTGCGTCCGCTGACGC TGAAAATGGTGGCTGATGCGATCGAAATGCACGAATCGACCATCAGCCGCGTCGCCACCAACAAATACATGATGACGCCT CGCGGTCTCTTCGAACTGCGCTACTTCTTCACGACTGCCATTGCCGCCGCCGACGGAGGCGATGCGCATTCGGCGGAGGC GGTGCGTGACCGGATCCGGCAGCTTGTGGAGGCGGAAGACCCCAACGAAGTGCTTTCCGACGATACGATTGTCGAGGTTC TGCGAAAGGACGGAATTGATATCGCCCGCAGGACGATAGCAAAATACCGGGAGGCGATGAACATCCCGTCGTCGGTTCAG CGCAGGCGCGAGAAGAGGGTGCTCGCCCGAGCCGGCGCATGA
Upstream 100 bases:
>100_bases TGCAAAAGCAATCCAACATTGGCCCGGTGCTTGACAAGCAAATATCGGGCCAGTTTTATCGCCATAAGCAGAAAAGCCCG TGAAGTGGGTAAAGGACGGA
Downstream 100 bases:
>100_bases CCGCATCGAGGCTCGACTTCGTGCCTCGATTTGACAAGAGTCGGCGAAACCACTAGAAGCCCGCCGCCAGAGGACGGCAG GATCGGTCATCTATCCTTCT
Product: RNA polymerase factor sigma-54
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 493; Mature: 492
Protein sequence:
>493_residues MALSTGIQLRQSQSLVMTPQLLQSIRLLQLTHIELELFISEEIERNPLLDLVDASEEVPASVLEERFASPDSAADIAERL DTSPEDLFPDDPDVRDTIGPDLMAQWRSAAGNGLVATGEDWNLEETTAAPATLRDHVREQIVLAFPDPVLKLIAEELLDG LDDAGYFTGDLNEIAERLAAETVLVERVLSICQTFDPPGLFARTLAECLALQLKARDRLDPAMQAMLSRLDLLSRRDFAS LKKVCGVDEEDLVEMLAEIRSLDPKPGTAFSSAPAEPVLPDVIVRPSAGGAWAIELNPEVLPRVLVNETYFTAVSTRAGK EEKAFLSECLQSANWLTRSLEQRARTILKVASEIVRQQDAFFVNGVRHLRPLTLKMVADAIEMHESTISRVATNKYMMTP RGLFELRYFFTTAIAAADGGDAHSAEAVRDRIRQLVEAEDPNEVLSDDTIVEVLRKDGIDIARRTIAKYREAMNIPSSVQ RRREKRVLARAGA
Sequences:
>Translated_493_residues MALSTGIQLRQSQSLVMTPQLLQSIRLLQLTHIELELFISEEIERNPLLDLVDASEEVPASVLEERFASPDSAADIAERL DTSPEDLFPDDPDVRDTIGPDLMAQWRSAAGNGLVATGEDWNLEETTAAPATLRDHVREQIVLAFPDPVLKLIAEELLDG LDDAGYFTGDLNEIAERLAAETVLVERVLSICQTFDPPGLFARTLAECLALQLKARDRLDPAMQAMLSRLDLLSRRDFAS LKKVCGVDEEDLVEMLAEIRSLDPKPGTAFSSAPAEPVLPDVIVRPSAGGAWAIELNPEVLPRVLVNETYFTAVSTRAGK EEKAFLSECLQSANWLTRSLEQRARTILKVASEIVRQQDAFFVNGVRHLRPLTLKMVADAIEMHESTISRVATNKYMMTP RGLFELRYFFTTAIAAADGGDAHSAEAVRDRIRQLVEAEDPNEVLSDDTIVEVLRKDGIDIARRTIAKYREAMNIPSSVQ RRREKRVLARAGA >Mature_492_residues ALSTGIQLRQSQSLVMTPQLLQSIRLLQLTHIELELFISEEIERNPLLDLVDASEEVPASVLEERFASPDSAADIAERLD TSPEDLFPDDPDVRDTIGPDLMAQWRSAAGNGLVATGEDWNLEETTAAPATLRDHVREQIVLAFPDPVLKLIAEELLDGL DDAGYFTGDLNEIAERLAAETVLVERVLSICQTFDPPGLFARTLAECLALQLKARDRLDPAMQAMLSRLDLLSRRDFASL KKVCGVDEEDLVEMLAEIRSLDPKPGTAFSSAPAEPVLPDVIVRPSAGGAWAIELNPEVLPRVLVNETYFTAVSTRAGKE EKAFLSECLQSANWLTRSLEQRARTILKVASEIVRQQDAFFVNGVRHLRPLTLKMVADAIEMHESTISRVATNKYMMTPR GLFELRYFFTTAIAAADGGDAHSAEAVRDRIRQLVEAEDPNEVLSDDTIVEVLRKDGIDIARRTIAKYREAMNIPSSVQR RREKRVLARAGA
Specific function: Sigma factors are initiation factors that promote the attachment of RNA polymerase to specific initiation sites and are then released. This sigma factor is responsible for the expression of the nitrogen fixation genes (nif operon), glnA and dctA for dicar
COG id: COG1508
COG function: function code K; DNA-directed RNA polymerase specialized sigma subunit, sigma54 homolog
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the sigma-54 factor family [H]
Homologues:
Organism=Escherichia coli, GI1789594, Length=498, Percent_Identity=38.1526104417671, Blast_Score=315, Evalue=5e-87,
Paralogues:
None
Copy number: 70 (log & stationary phase) [C]
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR000394 - InterPro: IPR007046 - InterPro: IPR007634 [H]
Pfam domain/function: PF00309 Sigma54_AID; PF04963 Sigma54_CBD; PF04552 Sigma54_DBD [H]
EC number: NA
Molecular weight: Translated: 54649; Mature: 54518
Theoretical pI: Translated: 4.45; Mature: 4.45
Prosite motif: PS00041 HTH_ARAC_FAMILY_1 ; PS00717 SIGMA54_1 ; PS00718 SIGMA54_2 ; PS50044 SIGMA54_3
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.8 %Cys (Translated Protein) 2.2 %Met (Translated Protein) 3.0 %Cys+Met (Translated Protein) 0.8 %Cys (Mature Protein) 2.0 %Met (Mature Protein) 2.8 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MALSTGIQLRQSQSLVMTPQLLQSIRLLQLTHIELELFISEEIERNPLLDLVDASEEVPA CCCCCCCHHHCCCCCEECHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHCCCCCCCH SVLEERFASPDSAADIAERLDTSPEDLFPDDPDVRDTIGPDLMAQWRSAAGNGLVATGED HHHHHHCCCCCHHHHHHHHCCCCCHHCCCCCCCCHHHCCHHHHHHHHHHCCCCEEECCCC WNLEETTAAPATLRDHVREQIVLAFPDPVLKLIAEELLDGLDDAGYFTGDLNEIAERLAA CCCCHHCCCHHHHHHHHHHHEEEECCCHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHH ETVLVERVLSICQTFDPPGLFARTLAECLALQLKARDRLDPAMQAMLSRLDLLSRRDFAS HHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHCCHHHH LKKVCGVDEEDLVEMLAEIRSLDPKPGTAFSSAPAEPVLPDVIVRPSAGGAWAIELNPEV HHHHHCCCHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCEEECCCCCEEEEEECHHH LPRVLVNETYFTAVSTRAGKEEKAFLSECLQSANWLTRSLEQRARTILKVASEIVRQQDA HHHHHHCCHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH FFVNGVRHLRPLTLKMVADAIEMHESTISRVATNKYMMTPRGLFELRYFFTTAIAAADGG HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCEEECCHHHHHHHHHHHHHHHHCCCC DAHSAEAVRDRIRQLVEAEDPNEVLSDDTIVEVLRKDGIDIARRTIAKYREAMNIPSSVQ CCCHHHHHHHHHHHHHCCCCCHHHHCHHHHHHHHHHCCHHHHHHHHHHHHHHHCCCHHHH RRREKRVLARAGA HHHHHHHHHHCCC >Mature Secondary Structure ALSTGIQLRQSQSLVMTPQLLQSIRLLQLTHIELELFISEEIERNPLLDLVDASEEVPA CCCCCCHHHCCCCCEECHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHCCCCCCCH SVLEERFASPDSAADIAERLDTSPEDLFPDDPDVRDTIGPDLMAQWRSAAGNGLVATGED HHHHHHCCCCCHHHHHHHHCCCCCHHCCCCCCCCHHHCCHHHHHHHHHHCCCCEEECCCC WNLEETTAAPATLRDHVREQIVLAFPDPVLKLIAEELLDGLDDAGYFTGDLNEIAERLAA CCCCHHCCCHHHHHHHHHHHEEEECCCHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHH ETVLVERVLSICQTFDPPGLFARTLAECLALQLKARDRLDPAMQAMLSRLDLLSRRDFAS HHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHCCHHHH LKKVCGVDEEDLVEMLAEIRSLDPKPGTAFSSAPAEPVLPDVIVRPSAGGAWAIELNPEV HHHHHCCCHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCEEECCCCCEEEEEECHHH LPRVLVNETYFTAVSTRAGKEEKAFLSECLQSANWLTRSLEQRARTILKVASEIVRQQDA HHHHHHCCHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH FFVNGVRHLRPLTLKMVADAIEMHESTISRVATNKYMMTPRGLFELRYFFTTAIAAADGG HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCEEECCHHHHHHHHHHHHHHHHCCCC DAHSAEAVRDRIRQLVEAEDPNEVLSDDTIVEVLRKDGIDIARRTIAKYREAMNIPSSVQ CCCHHHHHHHHHHHHHCCCCCHHHHCHHHHHHHHHHCCHHHHHHHHHHHHHHHCCCHHHH RRREKRVLARAGA HHHHHHHHHHCCC
PDB accession: NA
Resolution: NA
Structure class: Alpha
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: DNA [C]
Specific reaction: Protein + DNA = Protein-DNA [C]
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 2211497 [H]