Definition Candidatus Protochlamydia amoebophila UWE25, complete genome.
Accession NC_005861
Length 2,414,465

Click here to switch to the map view.

The map label for this gene is rpoN [H]

Identifier: 46447535

GI number: 46447535

Start: 2264714

End: 2266192

Strand: Reverse

Name: rpoN [H]

Synonym: pc1901

Alternate gene names: 46447535

Gene position: 2266192-2264714 (Counterclockwise)

Preceding gene: 46447536

Following gene: 46447533

Centisome position: 93.86

GC content: 35.23

Gene sequence:

>1479_bases
ATGAGTACAGTAGGGATTCCTTCTTCTTCTTTGCAAATGCAGCAAAAACAAGGAATGAACTTGACACAGCGTTTGATGAT
GTCAACTCATATGCAACAAGCCATTCATTTACTTCAATTGCCTATCTTAGAATTAGAGCCGTTTATTGAAGAACAAGTTG
TTTCAAATCCTTTGCTCGATATTATCCCTATAGAAAAAGAGGGAGCTTTTATAGAAGAACGCACTTCAGCTTCTGAAAAA
ATGGAAAAAGAAATCACGATTGATGATCGTGATTTGGCTATTTTGAACCGATTGGATGAAGATTATCGAGAGCATTTTGC
AGGAAGTGAAACAACGCCAATGAAAAGATCCAGTGAAGAAGAAAAGTTAAAAAGCTATTTAGAAAATTCAATTTGCGCGG
ATCCAAGTTTATTGGAAAAATTGCATCAACAAGCGATCGATACATTTAATAATCAACAAGAACTGGCTATTGCAGATATT
TTAATTGGTTATATTGACGCCAATGGTTTTTTGAAAACACCTCTTCAAGAAATTTGCCTTTTACATAATCTTGAAGAGTC
TGCGGTGAAAGATATTTTAAGAGAAATGCAGGAATTTGAGCCTTATGGAATCGCTGCCGCTTCTATTCAGGAGTCGCTAT
TAATTCAATTAAGATGCTTGCATAAGGAGGGAAAACTTGCTTACCGTCTTATTAAAGATTATTATAATGAATTGTTACAC
AATCATATTCCTTTGATTCAAAAACAATTAAAATGCTCTTTCTCGGAAATTCAAGAAGCGATTGAAAAGGATATCGCAAA
ATTAGATTTGCATCCTGGCACGCATTTCTCTGCTCAAACATCTCAAGTACTTATTCCCGATGTTACTTTGCGTCAAGAAG
GAGAAAAGCTTATTGTTGATGTTGATCGTGATAGAGCTCCTACCTTAAAAATTAATCGAAAATATTTGCGCTTGTTGAAC
GATTCTTCAACATCAAATGAAACAAAGCAATTCATTAAGCGACACCTTTTTTCAGCTCGGTGGCTTGTGCGAAATTTGCA
ACAGCGATATTCGACGATTGAAAGAATTGCTGAATTTTTAGCGGTTAATCAATATGAATTTTTTACACAGCCCGATGGAC
AGTTAAAACCTTTAACCATGAAAACGATTGCAGATGCTTTAGAATTGCATGAATCGACAATTGCAAGAACTGTCTCCAAT
AAATATATCAATAGTCCCAAAGGAATTTTTTCTCTCCGGTCTTTTTTTACAACCAAATATACGTCGGAAGAAGGGGAAGA
TCTTTCAGCTAAAACAGTAAAAGAGGCTATTTTAGAAATTATCAGTGGCGAAAATAAGCTTCGTCCTTTTTCCGATGAAA
AAATATCGGAATTTCTAAAAAGTAAAGGGATTACCTGCGCTAGACGCACCGTTGCTAAATATCGACAAGCCCTAGATTTA
GGAAATACGCAACAGCGTAAAAAATTTCATCAATCTTAA

Upstream 100 bases:

>100_bases
AAGTTAACTCCATTATTTAAGTTTTAGATTGCTGAGATAAGGATAAACCTATTATGTCTGATTTGAATAGGTAGTTAATA
AAAGCAACCAAGGATTTCAT

Downstream 100 bases:

>100_bases
GAGACTATAAGAATAAATGGCGTTGATTCGATGCGGATTAATTCTGCATCGAATCAACGCCATTTGTATATTACAATTTG
TTATTCATCACGATTGCCGC

Product: putative RNA polymerase sigma-54 factor (sigma-N)

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 492; Mature: 491

Protein sequence:

>492_residues
MSTVGIPSSSLQMQQKQGMNLTQRLMMSTHMQQAIHLLQLPILELEPFIEEQVVSNPLLDIIPIEKEGAFIEERTSASEK
MEKEITIDDRDLAILNRLDEDYREHFAGSETTPMKRSSEEEKLKSYLENSICADPSLLEKLHQQAIDTFNNQQELAIADI
LIGYIDANGFLKTPLQEICLLHNLEESAVKDILREMQEFEPYGIAAASIQESLLIQLRCLHKEGKLAYRLIKDYYNELLH
NHIPLIQKQLKCSFSEIQEAIEKDIAKLDLHPGTHFSAQTSQVLIPDVTLRQEGEKLIVDVDRDRAPTLKINRKYLRLLN
DSSTSNETKQFIKRHLFSARWLVRNLQQRYSTIERIAEFLAVNQYEFFTQPDGQLKPLTMKTIADALELHESTIARTVSN
KYINSPKGIFSLRSFFTTKYTSEEGEDLSAKTVKEAILEIISGENKLRPFSDEKISEFLKSKGITCARRTVAKYRQALDL
GNTQQRKKFHQS

Sequences:

>Translated_492_residues
MSTVGIPSSSLQMQQKQGMNLTQRLMMSTHMQQAIHLLQLPILELEPFIEEQVVSNPLLDIIPIEKEGAFIEERTSASEK
MEKEITIDDRDLAILNRLDEDYREHFAGSETTPMKRSSEEEKLKSYLENSICADPSLLEKLHQQAIDTFNNQQELAIADI
LIGYIDANGFLKTPLQEICLLHNLEESAVKDILREMQEFEPYGIAAASIQESLLIQLRCLHKEGKLAYRLIKDYYNELLH
NHIPLIQKQLKCSFSEIQEAIEKDIAKLDLHPGTHFSAQTSQVLIPDVTLRQEGEKLIVDVDRDRAPTLKINRKYLRLLN
DSSTSNETKQFIKRHLFSARWLVRNLQQRYSTIERIAEFLAVNQYEFFTQPDGQLKPLTMKTIADALELHESTIARTVSN
KYINSPKGIFSLRSFFTTKYTSEEGEDLSAKTVKEAILEIISGENKLRPFSDEKISEFLKSKGITCARRTVAKYRQALDL
GNTQQRKKFHQS
>Mature_491_residues
STVGIPSSSLQMQQKQGMNLTQRLMMSTHMQQAIHLLQLPILELEPFIEEQVVSNPLLDIIPIEKEGAFIEERTSASEKM
EKEITIDDRDLAILNRLDEDYREHFAGSETTPMKRSSEEEKLKSYLENSICADPSLLEKLHQQAIDTFNNQQELAIADIL
IGYIDANGFLKTPLQEICLLHNLEESAVKDILREMQEFEPYGIAAASIQESLLIQLRCLHKEGKLAYRLIKDYYNELLHN
HIPLIQKQLKCSFSEIQEAIEKDIAKLDLHPGTHFSAQTSQVLIPDVTLRQEGEKLIVDVDRDRAPTLKINRKYLRLLND
SSTSNETKQFIKRHLFSARWLVRNLQQRYSTIERIAEFLAVNQYEFFTQPDGQLKPLTMKTIADALELHESTIARTVSNK
YINSPKGIFSLRSFFTTKYTSEEGEDLSAKTVKEAILEIISGENKLRPFSDEKISEFLKSKGITCARRTVAKYRQALDLG
NTQQRKKFHQS

Specific function: Sigma factors are initiation factors that promote the attachment of RNA polymerase to specific initiation sites and are then released. This sigma factor is responsible for the expression of enzymes involved in arginine catabolism. The open complex (sigma-

COG id: COG1508

COG function: function code K; DNA-directed RNA polymerase specialized sigma subunit, sigma54 homolog

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the sigma-54 factor family [H]

Homologues:

Organism=Escherichia coli, GI1789594, Length=486, Percent_Identity=31.8930041152263, Blast_Score=237, Evalue=1e-63,

Paralogues:

None

Copy number: 70 (log & stationary phase) [C]

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR000394
- InterPro:   IPR007046
- InterPro:   IPR007634 [H]

Pfam domain/function: PF00309 Sigma54_AID; PF04963 Sigma54_CBD; PF04552 Sigma54_DBD [H]

EC number: NA

Molecular weight: Translated: 56544; Mature: 56413

Theoretical pI: Translated: 6.09; Mature: 6.09

Prosite motif: PS00718 SIGMA54_2 ; PS50044 SIGMA54_3

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.0 %Cys     (Translated Protein)
2.0 %Met     (Translated Protein)
3.0 %Cys+Met (Translated Protein)
1.0 %Cys     (Mature Protein)
1.8 %Met     (Mature Protein)
2.9 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSTVGIPSSSLQMQQKQGMNLTQRLMMSTHMQQAIHLLQLPILELEPFIEEQVVSNPLLD
CCCCCCCCHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHCCCCCE
IIPIEKEGAFIEERTSASEKMEKEITIDDRDLAILNRLDEDYREHFAGSETTPMKRSSEE
EEECCCCCCHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHCCCCCCCCCCCCCHH
EKLKSYLENSICADPSLLEKLHQQAIDTFNNQQELAIADILIGYIDANGFLKTPLQEICL
HHHHHHHHHHCCCCHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHCCCCCHHCCHHHHHH
LHNLEESAVKDILREMQEFEPYGIAAASIQESLLIQLRCLHKEGKLAYRLIKDYYNELLH
HHCCHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHH
NHIPLIQKQLKCSFSEIQEAIEKDIAKLDLHPGTHFSAQTSQVLIPDVTLRQEGEKLIVD
HHHHHHHHHHHCCHHHHHHHHHHHHHHCCCCCCCCCCCCCCCEECCCCHHHCCCCEEEEE
VDRDRAPTLKINRKYLRLLNDSSTSNETKQFIKRHLFSARWLVRNLQQRYSTIERIAEFL
ECCCCCCCEEHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
AVNQYEFFTQPDGQLKPLTMKTIADALELHESTIARTVSNKYINSPKGIFSLRSFFTTKY
HCCCHHEEECCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHC
TSEEGEDLSAKTVKEAILEIISGENKLRPFSDEKISEFLKSKGITCARRTVAKYRQALDL
CCCCCCCCHHHHHHHHHHHHHCCCCCCCCCCHHHHHHHHHHCCCHHHHHHHHHHHHHHCC
GNTQQRKKFHQS
CCHHHHHHHCCC
>Mature Secondary Structure 
STVGIPSSSLQMQQKQGMNLTQRLMMSTHMQQAIHLLQLPILELEPFIEEQVVSNPLLD
CCCCCCCHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHCCCCCE
IIPIEKEGAFIEERTSASEKMEKEITIDDRDLAILNRLDEDYREHFAGSETTPMKRSSEE
EEECCCCCCHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHCCCCCCCCCCCCCHH
EKLKSYLENSICADPSLLEKLHQQAIDTFNNQQELAIADILIGYIDANGFLKTPLQEICL
HHHHHHHHHHCCCCHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHCCCCCHHCCHHHHHH
LHNLEESAVKDILREMQEFEPYGIAAASIQESLLIQLRCLHKEGKLAYRLIKDYYNELLH
HHCCHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHH
NHIPLIQKQLKCSFSEIQEAIEKDIAKLDLHPGTHFSAQTSQVLIPDVTLRQEGEKLIVD
HHHHHHHHHHHCCHHHHHHHHHHHHHHCCCCCCCCCCCCCCCEECCCCHHHCCCCEEEEE
VDRDRAPTLKINRKYLRLLNDSSTSNETKQFIKRHLFSARWLVRNLQQRYSTIERIAEFL
ECCCCCCCEEHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
AVNQYEFFTQPDGQLKPLTMKTIADALELHESTIARTVSNKYINSPKGIFSLRSFFTTKY
HCCCHHEEECCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHC
TSEEGEDLSAKTVKEAILEIISGENKLRPFSDEKISEFLKSKGITCARRTVAKYRQALDL
CCCCCCCCHHHHHHHHHHHHHCCCCCCCCCCHHHHHHHHHHCCCHHHHHHHHHHHHHHCC
GNTQQRKKFHQS
CCHHHHHHHCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: DNA [C]

Specific reaction: Protein + DNA = Protein-DNA [C]

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 2203540; 8444818; 8025669; 7876255; 9278503 [H]