| Definition | Chloroflexus sp. Y-400-fl chromosome, complete genome. |
|---|---|
| Accession | NC_012032 |
| Length | 5,268,950 |
Click here to switch to the map view.
The map label for this gene is algU [H]
Identifier: 222523719
GI number: 222523719
Start: 504091
End: 504765
Strand: Direct
Name: algU [H]
Synonym: Chy400_0425
Alternate gene names: 222523719
Gene position: 504091-504765 (Clockwise)
Preceding gene: 222523718
Following gene: 222523720
Centisome position: 9.57
GC content: 54.81
Gene sequence:
>675_bases GTGGCTGAACCATCTCGTGAGACGATTGTACGCGCTCAACAGGGCGATCAGCAGGCCCTGACCGAATTAATCATCGGTCA GCAACATTATGTCTATAGCATCGCGATGAGCGTGCTCAAAAACGCTGATGATGCGGCTGATTTGACCCAGGAAGCGTTTA TTCGCCTGTTTCGGGCACTCCCCCAGTATAGCGGCGAAAGCCGTTTCACCACCTGGTTGTACCGGCTGGTTATCAATCTC TGTCGCGATGAGCTGCGCCGACGAGGTCGTCAGGCACCCATCGTTCCTCCCGCAACCGACGATGAGGAGCTTGACGCACT TCATACTGTCGCCGATAACGACCGTTGGGTCGATCCGGCCCAATCGCTCGATCTGAATCAGTTACGTCTCGAAGTCCGGC GTGCGCTTGAACAGCTTGAACCACACTACCGCCTTGTGTTGACGTTGTACTATTTTGAAGACTTGAAGTACACCGACATC GCCGAGATACTTGACCTTCCGCTCAATACGGTCAAAAGCCATATCCGGCGCGGCAAAGAACGACTGGCCCAACTCTTGCA AACCAACGAACCACCGGCAACCCGCGCCGTTAATCAACCCAAACGTTCGGCAACGGACGATCACGTGGTACAAATCACCC CCCTACGTCTGTTGCCGGGATGGGGAAGGAGGTAA
Upstream 100 bases:
>100_bases ACTTTTGCATTCGCAGAATCGTCAATACTATCAGCCAGTTTGCTGCGATGAGAACGCAGCGTCTAAGAGATGTCGGATTA CGACATCGGGAGTACAAACA
Downstream 100 bases:
>100_bases TCTATGAGCACGCAATTGCCTACACCACCTCCAGATGATCTGCTCGATGCGGCGCTTCGCCACGAATTACGTTGGGAGGC TCCGCCCGAACTGACCAATC
Product: ECF subfamily RNA polymerase sigma-24 subunit
Products: NA
Alternate protein names: Sigma-30 [H]
Number of amino acids: Translated: 224; Mature: 223
Protein sequence:
>224_residues MAEPSRETIVRAQQGDQQALTELIIGQQHYVYSIAMSVLKNADDAADLTQEAFIRLFRALPQYSGESRFTTWLYRLVINL CRDELRRRGRQAPIVPPATDDEELDALHTVADNDRWVDPAQSLDLNQLRLEVRRALEQLEPHYRLVLTLYYFEDLKYTDI AEILDLPLNTVKSHIRRGKERLAQLLQTNEPPATRAVNQPKRSATDDHVVQITPLRLLPGWGRR
Sequences:
>Translated_224_residues MAEPSRETIVRAQQGDQQALTELIIGQQHYVYSIAMSVLKNADDAADLTQEAFIRLFRALPQYSGESRFTTWLYRLVINL CRDELRRRGRQAPIVPPATDDEELDALHTVADNDRWVDPAQSLDLNQLRLEVRRALEQLEPHYRLVLTLYYFEDLKYTDI AEILDLPLNTVKSHIRRGKERLAQLLQTNEPPATRAVNQPKRSATDDHVVQITPLRLLPGWGRR >Mature_223_residues AEPSRETIVRAQQGDQQALTELIIGQQHYVYSIAMSVLKNADDAADLTQEAFIRLFRALPQYSGESRFTTWLYRLVINLC RDELRRRGRQAPIVPPATDDEELDALHTVADNDRWVDPAQSLDLNQLRLEVRRALEQLEPHYRLVLTLYYFEDLKYTDIA EILDLPLNTVKSHIRRGKERLAQLLQTNEPPATRAVNQPKRSATDDHVVQITPLRLLPGWGRR
Specific function: Sigma factors are initiation factors that promote the attachment of RNA polymerase to specific initiation sites and are then released. This sigma factor regulates genes such as algD, involved in alginate biosynthesis [H]
COG id: COG1595
COG function: function code K; DNA-directed RNA polymerase specialized sigma subunit, sigma24 homolog
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the sigma-70 factor family. ECF subfamily [H]
Homologues:
Organism=Escherichia coli, GI1788926, Length=179, Percent_Identity=34.0782122905028, Blast_Score=105, Evalue=3e-24,
Paralogues:
None
Copy number: <10 [C]
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR014284 - InterPro: IPR000838 - InterPro: IPR007627 - InterPro: IPR013249 - InterPro: IPR014286 - InterPro: IPR013325 - InterPro: IPR013324 [H]
Pfam domain/function: PF04542 Sigma70_r2; PF08281 Sigma70_r4_2 [H]
EC number: NA
Molecular weight: Translated: 25891; Mature: 25760
Theoretical pI: Translated: 6.37; Mature: 6.37
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.4 %Cys (Translated Protein) 0.9 %Met (Translated Protein) 1.3 %Cys+Met (Translated Protein) 0.4 %Cys (Mature Protein) 0.4 %Met (Mature Protein) 0.9 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MAEPSRETIVRAQQGDQQALTELIIGQQHYVYSIAMSVLKNADDAADLTQEAFIRLFRAL CCCCCHHHHHHHHCCCHHHHHHHHHCCHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHH PQYSGESRFTTWLYRLVINLCRDELRRRGRQAPIVPPATDDEELDALHTVADNDRWVDPA HCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCHHHHHHHHHHCCCCCCCCHH QSLDLNQLRLEVRRALEQLEPHYRLVLTLYYFEDLKYTDIAEILDLPLNTVKSHIRRGKE HHCCHHHHHHHHHHHHHHHCCHHHHHHHHHHHHCCCHHHHHHHHHCCHHHHHHHHHHHHH RLAQLLQTNEPPATRAVNQPKRSATDDHVVQITPLRLLPGWGRR HHHHHHHCCCCCCHHHCCCCCCCCCCCCEEEEECHHCCCCCCCC >Mature Secondary Structure AEPSRETIVRAQQGDQQALTELIIGQQHYVYSIAMSVLKNADDAADLTQEAFIRLFRAL CCCCHHHHHHHHCCCHHHHHHHHHCCHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHH PQYSGESRFTTWLYRLVINLCRDELRRRGRQAPIVPPATDDEELDALHTVADNDRWVDPA HCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCHHHHHHHHHHCCCCCCCCHH QSLDLNQLRLEVRRALEQLEPHYRLVLTLYYFEDLKYTDIAEILDLPLNTVKSHIRRGKE HHCCHHHHHHHHHHHHHHHCCHHHHHHHHHHHHCCCHHHHHHHHHCCHHHHHHHHHHHHH RLAQLLQTNEPPATRAVNQPKRSATDDHVVQITPLRLLPGWGRR HHHHHHHCCCCCCHHHCCCCCCCCCCCCEEEEECHHCCCCCCCC
PDB accession: NA
Resolution: NA
Structure class: Alpha
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: DNA [C]
Specific reaction: Protein + DNA = Protein-DNA [C]
General reaction: NA
Inhibitor: NA
Structure determination priority: 10.0
TargetDB status: NA
Availability: NA
References: 8432708; 8378309; 7961421; 10984043; 7737518 [H]