Definition Candidatus Solibacter usitatus Ellin6076 chromosome, complete genome.
Accession NC_008536
Length 9,965,640

Click here to switch to the map view.

The map label for this gene is algU [H]

Identifier: 116619510

GI number: 116619510

Start: 470191

End: 470739

Strand: Direct

Name: algU [H]

Synonym: Acid_0369

Alternate gene names: 116619510

Gene position: 470191-470739 (Clockwise)

Preceding gene: 116619508

Following gene: 116619511

Centisome position: 4.72

GC content: 56.1

Gene sequence:

>549_bases
GTGGAAACTGTAGTTTACAGCCAGATGAGCGAAGCCGTCGAGCCAGGCCTGGAATTGTTAGACCGGCAGAATCGCTTTGT
TTCCGACAATATGCGGCGGATCTTCATTCAGATCTACCGAATTGTGGGGAACGTCGCAGATGCGCAGGATCTTACCCAGG
AGGCCTTTATCAAGGCGCTCCAGCATCAGGAACAGCTCAAGGACGACAGAAAAGCCGCGCACTGGCTGTCGAAAATCGCG
ACAAATACGGCAATCGATTTCCTGAGGCGCAGCGGACGCGCCACGTTTTGCGAAATCGACGAGGCTCCGGAGAGCCAGAT
TGAGAGTCCGGAACAAACGCTGCTGCGAGGCGAGCATCGGGAATATCTCGAGGATGGATTGAGGCTTTTGAGTCCTCGGG
AACGCCAGGCGTTATTGCTCAGGGATGTGGAGGACATGCCGGCGGAGGAGGTAGCGCGGGTCTTGGATTGTTCCAAGGCG
ACGGTGCGGTCGCATATTGCGAATGCGCGCATCAAACTGCGGCGGTACATGGAAAGAAGGAAGCGGTAG

Upstream 100 bases:

>100_bases
CCCGGGGCGTAAAATACGCATAGGGGGGGCGGAAGTTTCCACAATGACCGCTTTCTTCTCCACGTTTTCCGGGATTCGGC
GTCATTCGTGATAGGAAGCC

Downstream 100 bases:

>100_bases
CAAAAATGAGGCACCCGAGTCAGGAAATATTGGCATTGCATGCGGGCGGCGATCTGGGGTGGCTGGAGCGGTGGAAGACC
GCGCGTCATCTTTCCGGTTG

Product: ECF subfamily RNA polymerase sigma-24 factor

Products: NA

Alternate protein names: Sigma-30 [H]

Number of amino acids: Translated: 182; Mature: 182

Protein sequence:

>182_residues
METVVYSQMSEAVEPGLELLDRQNRFVSDNMRRIFIQIYRIVGNVADAQDLTQEAFIKALQHQEQLKDDRKAAHWLSKIA
TNTAIDFLRRSGRATFCEIDEAPESQIESPEQTLLRGEHREYLEDGLRLLSPRERQALLLRDVEDMPAEEVARVLDCSKA
TVRSHIANARIKLRRYMERRKR

Sequences:

>Translated_182_residues
METVVYSQMSEAVEPGLELLDRQNRFVSDNMRRIFIQIYRIVGNVADAQDLTQEAFIKALQHQEQLKDDRKAAHWLSKIA
TNTAIDFLRRSGRATFCEIDEAPESQIESPEQTLLRGEHREYLEDGLRLLSPRERQALLLRDVEDMPAEEVARVLDCSKA
TVRSHIANARIKLRRYMERRKR
>Mature_182_residues
METVVYSQMSEAVEPGLELLDRQNRFVSDNMRRIFIQIYRIVGNVADAQDLTQEAFIKALQHQEQLKDDRKAAHWLSKIA
TNTAIDFLRRSGRATFCEIDEAPESQIESPEQTLLRGEHREYLEDGLRLLSPRERQALLLRDVEDMPAEEVARVLDCSKA
TVRSHIANARIKLRRYMERRKR

Specific function: Sigma factors are initiation factors that promote the attachment of RNA polymerase to specific initiation sites and are then released. This sigma factor regulates genes such as algD, involved in alginate biosynthesis [H]

COG id: COG1595

COG function: function code K; DNA-directed RNA polymerase specialized sigma subunit, sigma24 homolog

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the sigma-70 factor family. ECF subfamily [H]

Homologues:

Organism=Escherichia coli, GI1788926, Length=135, Percent_Identity=33.3333333333333, Blast_Score=71, Evalue=4e-14,

Paralogues:

None

Copy number: <10 [C]

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR014284
- InterPro:   IPR000838
- InterPro:   IPR007627
- InterPro:   IPR013249
- InterPro:   IPR014286
- InterPro:   IPR013325
- InterPro:   IPR013324 [H]

Pfam domain/function: PF04542 Sigma70_r2; PF08281 Sigma70_r4_2 [H]

EC number: NA

Molecular weight: Translated: 21252; Mature: 21252

Theoretical pI: Translated: 6.95; Mature: 6.95

Prosite motif: PS00622 HTH_LUXR_1

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.1 %Cys     (Translated Protein)
2.7 %Met     (Translated Protein)
3.8 %Cys+Met (Translated Protein)
1.1 %Cys     (Mature Protein)
2.7 %Met     (Mature Protein)
3.8 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
METVVYSQMSEAVEPGLELLDRQNRFVSDNMRRIFIQIYRIVGNVADAQDLTQEAFIKAL
CCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCHHHHHHHHHHHHHHHH
QHQEQLKDDRKAAHWLSKIATNTAIDFLRRSGRATFCEIDEAPESQIESPEQTLLRGEHR
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEECCCCCHHHCCCHHHHHHHCHHH
EYLEDGLRLLSPRERQALLLRDVEDMPAEEVARVLDCSKATVRSHIANARIKLRRYMERR
HHHHHHHHHHCCHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
KR
CC
>Mature Secondary Structure
METVVYSQMSEAVEPGLELLDRQNRFVSDNMRRIFIQIYRIVGNVADAQDLTQEAFIKAL
CCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCHHHHHHHHHHHHHHHH
QHQEQLKDDRKAAHWLSKIATNTAIDFLRRSGRATFCEIDEAPESQIESPEQTLLRGEHR
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEECCCCCHHHCCCHHHHHHHCHHH
EYLEDGLRLLSPRERQALLLRDVEDMPAEEVARVLDCSKATVRSHIANARIKLRRYMERR
HHHHHHHHHHCCHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
KR
CC

PDB accession: NA

Resolution: NA

Structure class: Alpha

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: DNA [C]

Specific reaction: Protein + DNA = Protein-DNA [C]

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: 8432708; 8378309; 7961421; 10984043; 7737518 [H]