Definition Psychrobacter sp. PRwf-1 chromosome, complete genome.
Accession NC_009524
Length 2,978,976

Click here to switch to the map view.

The map label for this gene is rpoN [H]

Identifier: 148652164

GI number: 148652164

Start: 424961

End: 426706

Strand: Direct

Name: rpoN [H]

Synonym: PsycPRwf_0352

Alternate gene names: 148652164

Gene position: 424961-426706 (Clockwise)

Preceding gene: 148652162

Following gene: 148652165

Centisome position: 14.27

GC content: 46.28

Gene sequence:

>1746_bases
ATGATAAGCACTTCCTTTAATTTAGGCTTTAATCTATCCACCACCCAAAAGCTGACACCTCAGATGCAGCAAGCCATTAA
GCTGTTGCAGTTATCAAGCCTTGAGCTTGAGCAAGAGGTGCAGATGAAGCTTGATAGCAATCCTTTATTAGAGCGGGTAG
AGGACGATGATATTGATGCTGAGGATTTTAACAGTATTGAGGAGCTGACTCGATTGGAGCTTGATGCCGAAGCACAAAAG
GAGGTGTATGACCCTTATGATGACGACTATGGCTTAGAGTATCAGGAAGGGGCGACTGAGGATGTATTTAGCGAGTTAGA
TGGCGATGGCTTAGGTAATTTAGGTGACTTAAACGACTTAAACGACTTAAACGAGAACGCGCTGGATGACACAAATAAAA
CAGAGGGGGATATAGAGCAAAACCAAGCTTTAATCAGTATTACCACCACAGCAGATAACGATCTTAAGGCTGAAGCATCA
AACCTAGACACCAGCCTCGGTGAGCTGCCGATAGACACTGAGTGGGATGATATCTATACCCATAGCCCCACTGGACTTGC
CGCACCAGATACCCAAGGCATGAGCGATTATCAAGGTGCAACCTCCGTCAGTTTACAAGACCACATTCGCTGGCAGCTCA
CTTTTAGTAAGCTGTCCTCAGTGCAGTCGCTTATCGCTGATTATTTGATTGATGCTTTGGATGACCACGGTTTTATTCAA
ATAGACATGGCTGAGCTAAAAGACAGCTTTGATGAAATGGCCAGCTTCTATCAGTGGCAGCAAAAAATAGAGTTAGAACA
TATCCAACAGGTCATCGAGCTGATTCAAAGCTGTGAGCCATTGGGAGTGGGGGCGCGCAATTTGGCCGAATCATTACAAA
TTCAGCTGCGTGCACTGGATGAGAATACCCCTTATATGCGTCAAGCGCTGCGTCTGCTAGATGAGCATCAACTGCTTGTG
AGTAACAATATTAAAGAATTGATGAGTCGCACGGGTCTAAAAAACAATGAAATCAGCCCCGCACTCGAATTGATTCGTAC
CCTGAATGCCGCGCCAGGGTTGGCTTTTTCTAAAGCGCAGCCAGACTATGGCAGTACTCCTGAGGTGTATGATATCCCTG
ATGTGATTGTACAACTGGTGCATAACCAAGGCGGCGGTGAGGCGGTGTGGAAGGTCGAGCTGAATCCAGAGACCCTGCCT
AAGCTAAGAATCAATCAGCAATATGCAAGCTTGGTTAAGCGCGGGGATGACAGCCCAGACAACGTGTATCTGCGTGATAA
TCTAATGGATGCCCGCTTATTTATCCGAAGCATCGAAGAGCGCAATCACAACCTACTTAAAGTGGCTACCTGCATTATAA
AAATGCAGCAAGATTTTTTATTACAAGGTGCCACTGCCATGAAGCCATTGATTTTAAAGGAAGTCGCTGAAGAGGTAGGT
CTGCATGAGTCTACCGTATCACGGTTGACCACCAGTAAAAGCATTTTAACCCCGCAAGGGCTGTTCTCCCTCAAGCACTT
CTTCTCCTCCCACGTCTCAAGTGATCAAGGTGACGTCTCCTCCACAGCCATTAGTGCCATGATTGAGGCATTAATTGACG
CTGAAGACCCCAAAAAGCCGATGTCGGACAGTGCCATCAAGCAGCATTTACAGCAGCAAGGTATAGATATTGCTCGGCGC
ACAGTGGCCAAATATCGAGAAGCCATGAATATTGGCTCTTCTACACAGCGCAAGTTAAAGTTCTAG

Upstream 100 bases:

>100_bases
ACTAATTTTCGTGATTTTCTAAATAATATGTGCTACTAATAAAGCGGCGTGTCCGGCCTGAGTCGGCCAGCAGTCCTCCC
TAATTGAGATAAATACCCTT

Downstream 100 bases:

>100_bases
TCGTTAGCGCTTAGCGGTGAGTTTTTTTGAAAATAAGTTTTTGCTGTTTTAGCCTAAACATAACCGAAGCGCAGGCCTCA
TCAAATCGTCACAAAGCCCC

Product: RNA polymerase, sigma 54 subunit, RpoN

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 581; Mature: 581

Protein sequence:

>581_residues
MISTSFNLGFNLSTTQKLTPQMQQAIKLLQLSSLELEQEVQMKLDSNPLLERVEDDDIDAEDFNSIEELTRLELDAEAQK
EVYDPYDDDYGLEYQEGATEDVFSELDGDGLGNLGDLNDLNDLNENALDDTNKTEGDIEQNQALISITTTADNDLKAEAS
NLDTSLGELPIDTEWDDIYTHSPTGLAAPDTQGMSDYQGATSVSLQDHIRWQLTFSKLSSVQSLIADYLIDALDDHGFIQ
IDMAELKDSFDEMASFYQWQQKIELEHIQQVIELIQSCEPLGVGARNLAESLQIQLRALDENTPYMRQALRLLDEHQLLV
SNNIKELMSRTGLKNNEISPALELIRTLNAAPGLAFSKAQPDYGSTPEVYDIPDVIVQLVHNQGGGEAVWKVELNPETLP
KLRINQQYASLVKRGDDSPDNVYLRDNLMDARLFIRSIEERNHNLLKVATCIIKMQQDFLLQGATAMKPLILKEVAEEVG
LHESTVSRLTTSKSILTPQGLFSLKHFFSSHVSSDQGDVSSTAISAMIEALIDAEDPKKPMSDSAIKQHLQQQGIDIARR
TVAKYREAMNIGSSTQRKLKF

Sequences:

>Translated_581_residues
MISTSFNLGFNLSTTQKLTPQMQQAIKLLQLSSLELEQEVQMKLDSNPLLERVEDDDIDAEDFNSIEELTRLELDAEAQK
EVYDPYDDDYGLEYQEGATEDVFSELDGDGLGNLGDLNDLNDLNENALDDTNKTEGDIEQNQALISITTTADNDLKAEAS
NLDTSLGELPIDTEWDDIYTHSPTGLAAPDTQGMSDYQGATSVSLQDHIRWQLTFSKLSSVQSLIADYLIDALDDHGFIQ
IDMAELKDSFDEMASFYQWQQKIELEHIQQVIELIQSCEPLGVGARNLAESLQIQLRALDENTPYMRQALRLLDEHQLLV
SNNIKELMSRTGLKNNEISPALELIRTLNAAPGLAFSKAQPDYGSTPEVYDIPDVIVQLVHNQGGGEAVWKVELNPETLP
KLRINQQYASLVKRGDDSPDNVYLRDNLMDARLFIRSIEERNHNLLKVATCIIKMQQDFLLQGATAMKPLILKEVAEEVG
LHESTVSRLTTSKSILTPQGLFSLKHFFSSHVSSDQGDVSSTAISAMIEALIDAEDPKKPMSDSAIKQHLQQQGIDIARR
TVAKYREAMNIGSSTQRKLKF
>Mature_581_residues
MISTSFNLGFNLSTTQKLTPQMQQAIKLLQLSSLELEQEVQMKLDSNPLLERVEDDDIDAEDFNSIEELTRLELDAEAQK
EVYDPYDDDYGLEYQEGATEDVFSELDGDGLGNLGDLNDLNDLNENALDDTNKTEGDIEQNQALISITTTADNDLKAEAS
NLDTSLGELPIDTEWDDIYTHSPTGLAAPDTQGMSDYQGATSVSLQDHIRWQLTFSKLSSVQSLIADYLIDALDDHGFIQ
IDMAELKDSFDEMASFYQWQQKIELEHIQQVIELIQSCEPLGVGARNLAESLQIQLRALDENTPYMRQALRLLDEHQLLV
SNNIKELMSRTGLKNNEISPALELIRTLNAAPGLAFSKAQPDYGSTPEVYDIPDVIVQLVHNQGGGEAVWKVELNPETLP
KLRINQQYASLVKRGDDSPDNVYLRDNLMDARLFIRSIEERNHNLLKVATCIIKMQQDFLLQGATAMKPLILKEVAEEVG
LHESTVSRLTTSKSILTPQGLFSLKHFFSSHVSSDQGDVSSTAISAMIEALIDAEDPKKPMSDSAIKQHLQQQGIDIARR
TVAKYREAMNIGSSTQRKLKF

Specific function: Sigma factors are initiation factors that promote the attachment of RNA polymerase to specific initiation sites and are then released. This sigma factor is responsible for the expression of the nitrogen fixation genes. The open complex (sigma-54 and core

COG id: COG1508

COG function: function code K; DNA-directed RNA polymerase specialized sigma subunit, sigma54 homolog

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the sigma-54 factor family [H]

Homologues:

Organism=Escherichia coli, GI1789594, Length=415, Percent_Identity=39.5180722891566, Blast_Score=316, Evalue=3e-87,

Paralogues:

None

Copy number: 70 (log & stationary phase) [C]

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR000394
- InterPro:   IPR007046
- InterPro:   IPR007634 [H]

Pfam domain/function: PF00309 Sigma54_AID; PF04963 Sigma54_CBD; PF04552 Sigma54_DBD [H]

EC number: NA

Molecular weight: Translated: 64955; Mature: 64955

Theoretical pI: Translated: 4.15; Mature: 4.15

Prosite motif: PS00717 SIGMA54_1 ; PS00718 SIGMA54_2 ; PS50044 SIGMA54_3

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.3 %Cys     (Translated Protein)
2.4 %Met     (Translated Protein)
2.8 %Cys+Met (Translated Protein)
0.3 %Cys     (Mature Protein)
2.4 %Met     (Mature Protein)
2.8 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MISTSFNLGFNLSTTQKLTPQMQQAIKLLQLSSLELEQEVQMKLDSNPLLERVEDDDIDA
CCCCCCCCCCCCCCHHHCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHCCCCCCCH
EDFNSIEELTRLELDAEAQKEVYDPYDDDYGLEYQEGATEDVFSELDGDGLGNLGDLNDL
HHHHHHHHHHHHHCCCHHHHHHCCCCCCCCCCCCCCCCHHHHHHHCCCCCCCCCCCCCCH
NDLNENALDDTNKTEGDIEQNQALISITTTADNDLKAEASNLDTSLGELPIDTEWDDIYT
HHCCHHHCCCCCCCCCCHHHCCEEEEEEECCCCCCHHHHHHCCHHHCCCCCCCCCCCCCC
HSPTGLAAPDTQGMSDYQGATSVSLQDHIRWQLTFSKLSSVQSLIADYLIDALDDHGFIQ
CCCCCCCCCCCCCCCCCCCCCCCCHHHHHEEEEEHHHHHHHHHHHHHHHHHHHCCCCEEE
IDMAELKDSFDEMASFYQWQQKIELEHIQQVIELIQSCEPLGVGARNLAESLQIQLRALD
EEHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHEECC
ENTPYMRQALRLLDEHQLLVSNNIKELMSRTGLKNNEISPALELIRTLNAAPGLAFSKAQ
CCCHHHHHHHHHHHHHHHHHHCCHHHHHHHCCCCCCCCHHHHHHHHHHCCCCCCCCCCCC
PDYGSTPEVYDIPDVIVQLVHNQGGGEAVWKVELNPETLPKLRINQQYASLVKRGDDSPD
CCCCCCCCCCCHHHHHHHHHHCCCCCCEEEEEECCCCCCCCCEECHHHHHHHHCCCCCCC
NVYLRDNLMDARLFIRSIEERNHNLLKVATCIIKMQQDFLLQGATAMKPLILKEVAEEVG
CEEEECCHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHC
LHESTVSRLTTSKSILTPQGLFSLKHFFSSHVSSDQGDVSSTAISAMIEALIDAEDPKKP
CCHHHHHHHHHCCHHCCHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHCCCCCCCC
MSDSAIKQHLQQQGIDIARRTVAKYREAMNIGSSTQRKLKF
CCHHHHHHHHHHHCHHHHHHHHHHHHHHHCCCCCCHHHCCC
>Mature Secondary Structure
MISTSFNLGFNLSTTQKLTPQMQQAIKLLQLSSLELEQEVQMKLDSNPLLERVEDDDIDA
CCCCCCCCCCCCCCHHHCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHCCCCCCCH
EDFNSIEELTRLELDAEAQKEVYDPYDDDYGLEYQEGATEDVFSELDGDGLGNLGDLNDL
HHHHHHHHHHHHHCCCHHHHHHCCCCCCCCCCCCCCCCHHHHHHHCCCCCCCCCCCCCCH
NDLNENALDDTNKTEGDIEQNQALISITTTADNDLKAEASNLDTSLGELPIDTEWDDIYT
HHCCHHHCCCCCCCCCCHHHCCEEEEEEECCCCCCHHHHHHCCHHHCCCCCCCCCCCCCC
HSPTGLAAPDTQGMSDYQGATSVSLQDHIRWQLTFSKLSSVQSLIADYLIDALDDHGFIQ
CCCCCCCCCCCCCCCCCCCCCCCCHHHHHEEEEEHHHHHHHHHHHHHHHHHHHCCCCEEE
IDMAELKDSFDEMASFYQWQQKIELEHIQQVIELIQSCEPLGVGARNLAESLQIQLRALD
EEHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHEECC
ENTPYMRQALRLLDEHQLLVSNNIKELMSRTGLKNNEISPALELIRTLNAAPGLAFSKAQ
CCCHHHHHHHHHHHHHHHHHHCCHHHHHHHCCCCCCCCHHHHHHHHHHCCCCCCCCCCCC
PDYGSTPEVYDIPDVIVQLVHNQGGGEAVWKVELNPETLPKLRINQQYASLVKRGDDSPD
CCCCCCCCCCCHHHHHHHHHHCCCCCCEEEEEECCCCCCCCCEECHHHHHHHHCCCCCCC
NVYLRDNLMDARLFIRSIEERNHNLLKVATCIIKMQQDFLLQGATAMKPLILKEVAEEVG
CEEEECCHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHC
LHESTVSRLTTSKSILTPQGLFSLKHFFSSHVSSDQGDVSSTAISAMIEALIDAEDPKKP
CCHHHHHHHHHCCHHCCHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHCCCCCCCC
MSDSAIKQHLQQQGIDIARRTVAKYREAMNIGSSTQRKLKF
CCHHHHHHHHHHHCHHHHHHHHHHHHHHHCCCCCCHHHCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: DNA [C]

Specific reaction: Protein + DNA = Protein-DNA [C]

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 3481423 [H]