Definition Chloroflexus sp. Y-400-fl chromosome, complete genome.
Accession NC_012032
Length 5,268,950

Click here to switch to the map view.

The map label for this gene is algU [H]

Identifier: 222523719

GI number: 222523719

Start: 504091

End: 504765

Strand: Direct

Name: algU [H]

Synonym: Chy400_0425

Alternate gene names: 222523719

Gene position: 504091-504765 (Clockwise)

Preceding gene: 222523718

Following gene: 222523720

Centisome position: 9.57

GC content: 54.81

Gene sequence:

>675_bases
GTGGCTGAACCATCTCGTGAGACGATTGTACGCGCTCAACAGGGCGATCAGCAGGCCCTGACCGAATTAATCATCGGTCA
GCAACATTATGTCTATAGCATCGCGATGAGCGTGCTCAAAAACGCTGATGATGCGGCTGATTTGACCCAGGAAGCGTTTA
TTCGCCTGTTTCGGGCACTCCCCCAGTATAGCGGCGAAAGCCGTTTCACCACCTGGTTGTACCGGCTGGTTATCAATCTC
TGTCGCGATGAGCTGCGCCGACGAGGTCGTCAGGCACCCATCGTTCCTCCCGCAACCGACGATGAGGAGCTTGACGCACT
TCATACTGTCGCCGATAACGACCGTTGGGTCGATCCGGCCCAATCGCTCGATCTGAATCAGTTACGTCTCGAAGTCCGGC
GTGCGCTTGAACAGCTTGAACCACACTACCGCCTTGTGTTGACGTTGTACTATTTTGAAGACTTGAAGTACACCGACATC
GCCGAGATACTTGACCTTCCGCTCAATACGGTCAAAAGCCATATCCGGCGCGGCAAAGAACGACTGGCCCAACTCTTGCA
AACCAACGAACCACCGGCAACCCGCGCCGTTAATCAACCCAAACGTTCGGCAACGGACGATCACGTGGTACAAATCACCC
CCCTACGTCTGTTGCCGGGATGGGGAAGGAGGTAA

Upstream 100 bases:

>100_bases
ACTTTTGCATTCGCAGAATCGTCAATACTATCAGCCAGTTTGCTGCGATGAGAACGCAGCGTCTAAGAGATGTCGGATTA
CGACATCGGGAGTACAAACA

Downstream 100 bases:

>100_bases
TCTATGAGCACGCAATTGCCTACACCACCTCCAGATGATCTGCTCGATGCGGCGCTTCGCCACGAATTACGTTGGGAGGC
TCCGCCCGAACTGACCAATC

Product: ECF subfamily RNA polymerase sigma-24 subunit

Products: NA

Alternate protein names: Sigma-30 [H]

Number of amino acids: Translated: 224; Mature: 223

Protein sequence:

>224_residues
MAEPSRETIVRAQQGDQQALTELIIGQQHYVYSIAMSVLKNADDAADLTQEAFIRLFRALPQYSGESRFTTWLYRLVINL
CRDELRRRGRQAPIVPPATDDEELDALHTVADNDRWVDPAQSLDLNQLRLEVRRALEQLEPHYRLVLTLYYFEDLKYTDI
AEILDLPLNTVKSHIRRGKERLAQLLQTNEPPATRAVNQPKRSATDDHVVQITPLRLLPGWGRR

Sequences:

>Translated_224_residues
MAEPSRETIVRAQQGDQQALTELIIGQQHYVYSIAMSVLKNADDAADLTQEAFIRLFRALPQYSGESRFTTWLYRLVINL
CRDELRRRGRQAPIVPPATDDEELDALHTVADNDRWVDPAQSLDLNQLRLEVRRALEQLEPHYRLVLTLYYFEDLKYTDI
AEILDLPLNTVKSHIRRGKERLAQLLQTNEPPATRAVNQPKRSATDDHVVQITPLRLLPGWGRR
>Mature_223_residues
AEPSRETIVRAQQGDQQALTELIIGQQHYVYSIAMSVLKNADDAADLTQEAFIRLFRALPQYSGESRFTTWLYRLVINLC
RDELRRRGRQAPIVPPATDDEELDALHTVADNDRWVDPAQSLDLNQLRLEVRRALEQLEPHYRLVLTLYYFEDLKYTDIA
EILDLPLNTVKSHIRRGKERLAQLLQTNEPPATRAVNQPKRSATDDHVVQITPLRLLPGWGRR

Specific function: Sigma factors are initiation factors that promote the attachment of RNA polymerase to specific initiation sites and are then released. This sigma factor regulates genes such as algD, involved in alginate biosynthesis [H]

COG id: COG1595

COG function: function code K; DNA-directed RNA polymerase specialized sigma subunit, sigma24 homolog

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the sigma-70 factor family. ECF subfamily [H]

Homologues:

Organism=Escherichia coli, GI1788926, Length=179, Percent_Identity=34.0782122905028, Blast_Score=105, Evalue=3e-24,

Paralogues:

None

Copy number: <10 [C]

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR014284
- InterPro:   IPR000838
- InterPro:   IPR007627
- InterPro:   IPR013249
- InterPro:   IPR014286
- InterPro:   IPR013325
- InterPro:   IPR013324 [H]

Pfam domain/function: PF04542 Sigma70_r2; PF08281 Sigma70_r4_2 [H]

EC number: NA

Molecular weight: Translated: 25891; Mature: 25760

Theoretical pI: Translated: 6.37; Mature: 6.37

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.4 %Cys     (Translated Protein)
0.9 %Met     (Translated Protein)
1.3 %Cys+Met (Translated Protein)
0.4 %Cys     (Mature Protein)
0.4 %Met     (Mature Protein)
0.9 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MAEPSRETIVRAQQGDQQALTELIIGQQHYVYSIAMSVLKNADDAADLTQEAFIRLFRAL
CCCCCHHHHHHHHCCCHHHHHHHHHCCHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHH
PQYSGESRFTTWLYRLVINLCRDELRRRGRQAPIVPPATDDEELDALHTVADNDRWVDPA
HCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCHHHHHHHHHHCCCCCCCCHH
QSLDLNQLRLEVRRALEQLEPHYRLVLTLYYFEDLKYTDIAEILDLPLNTVKSHIRRGKE
HHCCHHHHHHHHHHHHHHHCCHHHHHHHHHHHHCCCHHHHHHHHHCCHHHHHHHHHHHHH
RLAQLLQTNEPPATRAVNQPKRSATDDHVVQITPLRLLPGWGRR
HHHHHHHCCCCCCHHHCCCCCCCCCCCCEEEEECHHCCCCCCCC
>Mature Secondary Structure 
AEPSRETIVRAQQGDQQALTELIIGQQHYVYSIAMSVLKNADDAADLTQEAFIRLFRAL
CCCCHHHHHHHHCCCHHHHHHHHHCCHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHH
PQYSGESRFTTWLYRLVINLCRDELRRRGRQAPIVPPATDDEELDALHTVADNDRWVDPA
HCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCHHHHHHHHHHCCCCCCCCHH
QSLDLNQLRLEVRRALEQLEPHYRLVLTLYYFEDLKYTDIAEILDLPLNTVKSHIRRGKE
HHCCHHHHHHHHHHHHHHHCCHHHHHHHHHHHHCCCHHHHHHHHHCCHHHHHHHHHHHHH
RLAQLLQTNEPPATRAVNQPKRSATDDHVVQITPLRLLPGWGRR
HHHHHHHCCCCCCHHHCCCCCCCCCCCCEEEEECHHCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: DNA [C]

Specific reaction: Protein + DNA = Protein-DNA [C]

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: 8432708; 8378309; 7961421; 10984043; 7737518 [H]