Definition Kosmotoga olearia TBF 19.5.1, complete genome.
Accession NC_012785
Length 2,302,126

Click here to switch to the map view.

The map label for this gene is rpoN [H]

Identifier: 239617783

GI number: 239617783

Start: 1499441

End: 1500604

Strand: Reverse

Name: rpoN [H]

Synonym: Kole_1408

Alternate gene names: 239617783

Gene position: 1500604-1499441 (Counterclockwise)

Preceding gene: 239617784

Following gene: 239617782

Centisome position: 65.18

GC content: 40.29

Gene sequence:

>1164_bases
ATGAAACTTGAACACAAACTTTCGCAAAAGCTCGAACAAAAGTTGCACCTATCTTTGAAAGTGCAGCACGTGTTGAAACT
ATTACAACTAAATTCACTAGAGCTCATGACAGAGCTCAGAGAAATTGTTGATGGCAACCCCCTACTTGAACTGGAGGGAG
AGGATTACAAATTAATCGACGAAAACGATATTGAAACACCCGAAGAAGAAAATTACGAGTCCAAAAGTGATTCCCCTTAC
TTTCCGAAGCACTACAACCCCGATTTCGACGGTTGGGACTTTGAACGTCTTGAAGGGCCGCAGCCTTCTTTTGAAGAAAT
GCTTCGCAATTTCGCTTTTTACATTTTAGAGGACGATGAATTCAAAATATTCGAAATTCTTATGGACAACATGAACGAGT
TTGGTCTGTTAAAAAGGTCAATCGAAGAGATTTCAAGAGAAGTTGCGGTGAATGAACGCGACATAAGAAAAGTTATAAAA
AAGCTCAGAGATTCCGGATTTGACGGTCTGTTCGCCGAAAAGCTCGAAGAATTGAAGGAACTCGGTGAAGGAATCGTACT
TCCCTCATCCGGTTACAACGATGGAAATCCTATCATGTACATAGAGCCTGAACTTTACATTGATTTCGTGGATAATAGAT
TCATTGTTACTGCAAAGGATTACGGATTGGCCATACGGGTGGACGAAGTATATCGGGAACTTCTAAAAAACGAAAAGGAT
GAAGCAGGGAAATTCCTTAAGGAAAAATTCCAGGAGGCGGAGTTTTACGTAAATGCCCTTGAAAAAAGACGCAGTACATT
GATCACAATAGGTGAAGAACTGGTTAGAACTAATCCTGATTTTCTACTCGGTTACTGCAAAACCCTCAGACCTTTAAAAA
TGACAGACATTGCTGAAAAGCTCGATGTTGTTGTTTCAACCATTAGCAGGGCGGTGAAAGGAAAATTCGTACAGACTCCC
ATAGGGACCTTCCCGCTCAGATACTTTTTTGGTAGCGAACAAACACGCGAACAGGCCATGGAAATCATAGCCAAGCTTTT
GAAAGAGAATCCAAAGTTGAGCGATTCAGCGATAGCAAAAAAACTAAATGAAATAGGTATAAAAATAGCCCGAAGAACGG
TTAATAAATACCGTAACGTTCTTCTCAAAAAAGGTGAACTATGA

Upstream 100 bases:

>100_bases
GAAGCCTCTATGAGCGCGTCACAGGTGAGTTCTGTTTATTCTAAAATATTTAAACACCTTAATACAATTAGGGCTTCTAC
AGGAAAAATCGGGGGCAATC

Downstream 100 bases:

>100_bases
ATTTAGCGGCAGTTTTTCTTGGCGGGAATGATGGACATTCCGACAAATTTTATAGAGAAAAAGCAAATTCAGCAGATTTG
ATCGTCGCTGTCGATTCCGG

Product: sigma-54 DNA-binding domain protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 387; Mature: 387

Protein sequence:

>387_residues
MKLEHKLSQKLEQKLHLSLKVQHVLKLLQLNSLELMTELREIVDGNPLLELEGEDYKLIDENDIETPEEENYESKSDSPY
FPKHYNPDFDGWDFERLEGPQPSFEEMLRNFAFYILEDDEFKIFEILMDNMNEFGLLKRSIEEISREVAVNERDIRKVIK
KLRDSGFDGLFAEKLEELKELGEGIVLPSSGYNDGNPIMYIEPELYIDFVDNRFIVTAKDYGLAIRVDEVYRELLKNEKD
EAGKFLKEKFQEAEFYVNALEKRRSTLITIGEELVRTNPDFLLGYCKTLRPLKMTDIAEKLDVVVSTISRAVKGKFVQTP
IGTFPLRYFFGSEQTREQAMEIIAKLLKENPKLSDSAIAKKLNEIGIKIARRTVNKYRNVLLKKGEL

Sequences:

>Translated_387_residues
MKLEHKLSQKLEQKLHLSLKVQHVLKLLQLNSLELMTELREIVDGNPLLELEGEDYKLIDENDIETPEEENYESKSDSPY
FPKHYNPDFDGWDFERLEGPQPSFEEMLRNFAFYILEDDEFKIFEILMDNMNEFGLLKRSIEEISREVAVNERDIRKVIK
KLRDSGFDGLFAEKLEELKELGEGIVLPSSGYNDGNPIMYIEPELYIDFVDNRFIVTAKDYGLAIRVDEVYRELLKNEKD
EAGKFLKEKFQEAEFYVNALEKRRSTLITIGEELVRTNPDFLLGYCKTLRPLKMTDIAEKLDVVVSTISRAVKGKFVQTP
IGTFPLRYFFGSEQTREQAMEIIAKLLKENPKLSDSAIAKKLNEIGIKIARRTVNKYRNVLLKKGEL
>Mature_387_residues
MKLEHKLSQKLEQKLHLSLKVQHVLKLLQLNSLELMTELREIVDGNPLLELEGEDYKLIDENDIETPEEENYESKSDSPY
FPKHYNPDFDGWDFERLEGPQPSFEEMLRNFAFYILEDDEFKIFEILMDNMNEFGLLKRSIEEISREVAVNERDIRKVIK
KLRDSGFDGLFAEKLEELKELGEGIVLPSSGYNDGNPIMYIEPELYIDFVDNRFIVTAKDYGLAIRVDEVYRELLKNEKD
EAGKFLKEKFQEAEFYVNALEKRRSTLITIGEELVRTNPDFLLGYCKTLRPLKMTDIAEKLDVVVSTISRAVKGKFVQTP
IGTFPLRYFFGSEQTREQAMEIIAKLLKENPKLSDSAIAKKLNEIGIKIARRTVNKYRNVLLKKGEL

Specific function: Sigma factors are initiation factors that promote the attachment of RNA polymerase to specific initiation sites and are then released. This sigma factor is responsible for the expression of the nitrogen fixation genes. The open complex (sigma-54 and core

COG id: COG1508

COG function: function code K; DNA-directed RNA polymerase specialized sigma subunit, sigma54 homolog

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the sigma-54 factor family [H]

Homologues:

Organism=Escherichia coli, GI1789594, Length=468, Percent_Identity=26.0683760683761, Blast_Score=121, Evalue=7e-29,

Paralogues:

None

Copy number: 70 (log & stationary phase) [C]

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR000394
- InterPro:   IPR007046
- InterPro:   IPR007634 [H]

Pfam domain/function: PF00309 Sigma54_AID; PF04963 Sigma54_CBD; PF04552 Sigma54_DBD [H]

EC number: NA

Molecular weight: Translated: 45084; Mature: 45084

Theoretical pI: Translated: 4.75; Mature: 4.75

Prosite motif: PS00718 SIGMA54_2 ; PS50044 SIGMA54_3

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.3 %Cys     (Translated Protein)
2.1 %Met     (Translated Protein)
2.3 %Cys+Met (Translated Protein)
0.3 %Cys     (Mature Protein)
2.1 %Met     (Mature Protein)
2.3 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKLEHKLSQKLEQKLHLSLKVQHVLKLLQLNSLELMTELREIVDGNPLLELEGEDYKLID
CCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHCCCCEEEECCCCEEEEC
ENDIETPEEENYESKSDSPYFPKHYNPDFDGWDFERLEGPQPSFEEMLRNFAFYILEDDE
CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHCCCCCCCHHHHHHHHEEEEEECCC
FKIFEILMDNMNEFGLLKRSIEEISREVAVNERDIRKVIKKLRDSGFDGLFAEKLEELKE
HHHHHHHHHCCHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHCCCCCHHHHHHHHHHH
LGEGIVLPSSGYNDGNPIMYIEPELYIDFVDNRFIVTAKDYGLAIRVDEVYRELLKNEKD
HCCCEEECCCCCCCCCCEEEECCCEEEEEECCEEEEEEECCCEEEEHHHHHHHHHHCCHH
EAGKFLKEKFQEAEFYVNALEKRRSTLITIGEELVRTNPDFLLGYCKTLRPLKMTDIAEK
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHCCCCHHHHHHHH
LDVVVSTISRAVKGKFVQTPIGTFPLRYFFGSEQTREQAMEIIAKLLKENPKLSDSAIAK
HHHHHHHHHHHHCCCHHCCCCCCHHHHHHCCCHHHHHHHHHHHHHHHHCCCCCCHHHHHH
KLNEIGIKIARRTVNKYRNVLLKKGEL
HHHHHHHHHHHHHHHHHHHHHHCCCCC
>Mature Secondary Structure
MKLEHKLSQKLEQKLHLSLKVQHVLKLLQLNSLELMTELREIVDGNPLLELEGEDYKLID
CCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHCCCCEEEECCCCEEEEC
ENDIETPEEENYESKSDSPYFPKHYNPDFDGWDFERLEGPQPSFEEMLRNFAFYILEDDE
CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHCCCCCCCHHHHHHHHEEEEEECCC
FKIFEILMDNMNEFGLLKRSIEEISREVAVNERDIRKVIKKLRDSGFDGLFAEKLEELKE
HHHHHHHHHCCHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHCCCCCHHHHHHHHHHH
LGEGIVLPSSGYNDGNPIMYIEPELYIDFVDNRFIVTAKDYGLAIRVDEVYRELLKNEKD
HCCCEEECCCCCCCCCCEEEECCCEEEEEECCEEEEEEECCCEEEEHHHHHHHHHHCCHH
EAGKFLKEKFQEAEFYVNALEKRRSTLITIGEELVRTNPDFLLGYCKTLRPLKMTDIAEK
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHCCCCHHHHHHHH
LDVVVSTISRAVKGKFVQTPIGTFPLRYFFGSEQTREQAMEIIAKLLKENPKLSDSAIAK
HHHHHHHHHHHHCCCHHCCCCCCHHHHHHCCCHHHHHHHHHHHHHHHHCCCCCCHHHHHH
KLNEIGIKIARRTVNKYRNVLLKKGEL
HHHHHHHHHHHHHHHHHHHHHHCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: DNA [C]

Specific reaction: Protein + DNA = Protein-DNA [C]

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 2999700; 2695747 [H]