Definition Leptospira interrogans serovar Copenhageni str. Fiocruz L1-130 chromosome chromosome I, complete sequence.
Accession NC_005823
Length 4,277,185

Click here to switch to the map view.

The map label for this gene is algU [H]

Identifier: 45658332

GI number: 45658332

Start: 3016639

End: 3017259

Strand: Reverse

Name: algU [H]

Synonym: LIC12490

Alternate gene names: 45658332

Gene position: 3017259-3016639 (Counterclockwise)

Preceding gene: 45658333

Following gene: 45658331

Centisome position: 70.54

GC content: 39.29

Gene sequence:

>621_bases
ATGGATTCTTCTACAAAAAAGGAACAAAAACAAATCGTTCCTAAAAAGCCTACTTTAAGGGAGATCGAAATTGGTCTACT
CAAGAAGATCAAAGAAGGGGACGATGAAGCGTATATTCAACTTGTCAGTCTGTTTCGAGAAAGACTTTATCGTAAGGCGA
TTTCGATGGTAAAAGACGGAGACGACGCGGAAGACATTGTTCAAGACGCTCTCATTTCTGGTTATAGATCCATTCGTAAT
TTTAGGGCAGATTCCGGAGTTTACACTTGGCTTTATCGGATTGTAGTTAACAAATCCAAGGATATGTTAGCGAAACGGAA
ACGAGCTAAAGAAAATTCTATGGATGATAAGGAATATCAGGTGACGGACGATCGATTGGGGTTCGAAAAAAAAATTGAAC
TTAGTGATGAGTCCAACTATCTAATTAGCAAAATCAACGGCTTGGAAGATCTCTATAAAGAGGTAATCGAACTCAGATAC
TTTGAGGAAATGTCATACGCGCAAATTGCGGAGGTTCTGGGAACGAACGTAGGAACCGTAAAGAGCAGACTCTTTAAGGC
CAAAGAATTCCTAAAACATTTGATTCTACAAGACGGTAAGGGTGAAGGATACTTTAGGTAA

Upstream 100 bases:

>100_bases
CCTGGTTTTGATCAATCTTTCCTTACAAAATCCGTAACTCTTAGTTTTTCGTTCTAAGTTTCCGGATTGCCATATTCTCT
TCCTTGAGGATCTTTGAATC

Downstream 100 bases:

>100_bases
AAAAATGAAAAAATTACATTCAAAATTTAGAATTCCGCTTTTTCTTCGAAAGGAAGACGGAGATCTGCTTAAAATTGAAA
ATTCGCTTGTAAAAACTATG

Product: RNA polymerase ECF-type sigma factor

Products: NA

Alternate protein names: Sigma-30 [H]

Number of amino acids: Translated: 206; Mature: 206

Protein sequence:

>206_residues
MDSSTKKEQKQIVPKKPTLREIEIGLLKKIKEGDDEAYIQLVSLFRERLYRKAISMVKDGDDAEDIVQDALISGYRSIRN
FRADSGVYTWLYRIVVNKSKDMLAKRKRAKENSMDDKEYQVTDDRLGFEKKIELSDESNYLISKINGLEDLYKEVIELRY
FEEMSYAQIAEVLGTNVGTVKSRLFKAKEFLKHLILQDGKGEGYFR

Sequences:

>Translated_206_residues
MDSSTKKEQKQIVPKKPTLREIEIGLLKKIKEGDDEAYIQLVSLFRERLYRKAISMVKDGDDAEDIVQDALISGYRSIRN
FRADSGVYTWLYRIVVNKSKDMLAKRKRAKENSMDDKEYQVTDDRLGFEKKIELSDESNYLISKINGLEDLYKEVIELRY
FEEMSYAQIAEVLGTNVGTVKSRLFKAKEFLKHLILQDGKGEGYFR
>Mature_206_residues
MDSSTKKEQKQIVPKKPTLREIEIGLLKKIKEGDDEAYIQLVSLFRERLYRKAISMVKDGDDAEDIVQDALISGYRSIRN
FRADSGVYTWLYRIVVNKSKDMLAKRKRAKENSMDDKEYQVTDDRLGFEKKIELSDESNYLISKINGLEDLYKEVIELRY
FEEMSYAQIAEVLGTNVGTVKSRLFKAKEFLKHLILQDGKGEGYFR

Specific function: Sigma factors are initiation factors that promote the attachment of RNA polymerase to specific initiation sites and are then released. This sigma factor regulates genes such as algD, involved in alginate biosynthesis [H]

COG id: COG1595

COG function: function code K; DNA-directed RNA polymerase specialized sigma subunit, sigma24 homolog

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the sigma-70 factor family. ECF subfamily [H]

Homologues:

Organism=Escherichia coli, GI1788926, Length=174, Percent_Identity=32.183908045977, Blast_Score=96, Evalue=2e-21,

Paralogues:

None

Copy number: <10 [C]

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR014284
- InterPro:   IPR000838
- InterPro:   IPR007627
- InterPro:   IPR013249
- InterPro:   IPR014286
- InterPro:   IPR013325
- InterPro:   IPR013324 [H]

Pfam domain/function: PF04542 Sigma70_r2; PF08281 Sigma70_r4_2 [H]

EC number: NA

Molecular weight: Translated: 24013; Mature: 24013

Theoretical pI: Translated: 9.03; Mature: 9.03

Prosite motif: PS01063 SIGMA70_ECF

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.0 %Cys     (Translated Protein)
2.4 %Met     (Translated Protein)
2.4 %Cys+Met (Translated Protein)
0.0 %Cys     (Mature Protein)
2.4 %Met     (Mature Protein)
2.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MDSSTKKEQKQIVPKKPTLREIEIGLLKKIKEGDDEAYIQLVSLFRERLYRKAISMVKDG
CCCCCHHHHHHCCCCCCCHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHCCC
DDAEDIVQDALISGYRSIRNFRADSGVYTWLYRIVVNKSKDMLAKRKRAKENSMDDKEYQ
CCHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHCCCHHHHHHHHHHHHCCCCCCCEE
VTDDRLGFEKKIELSDESNYLISKINGLEDLYKEVIELRYFEEMSYAQIAEVLGTNVGTV
CCHHHCCCHHEEECCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHH
KSRLFKAKEFLKHLILQDGKGEGYFR
HHHHHHHHHHHHHHHHCCCCCCCCCC
>Mature Secondary Structure
MDSSTKKEQKQIVPKKPTLREIEIGLLKKIKEGDDEAYIQLVSLFRERLYRKAISMVKDG
CCCCCHHHHHHCCCCCCCHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHCCC
DDAEDIVQDALISGYRSIRNFRADSGVYTWLYRIVVNKSKDMLAKRKRAKENSMDDKEYQ
CCHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHCCCHHHHHHHHHHHHCCCCCCCEE
VTDDRLGFEKKIELSDESNYLISKINGLEDLYKEVIELRYFEEMSYAQIAEVLGTNVGTV
CCHHHCCCHHEEECCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHH
KSRLFKAKEFLKHLILQDGKGEGYFR
HHHHHHHHHHHHHHHHCCCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: DNA [C]

Specific reaction: Protein + DNA = Protein-DNA [C]

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: 8432708; 8378309; 7961421; 10984043; 7737518 [H]