Definition Rhodopseudomonas palustris HaA2, complete genome.
Accession NC_007778
Length 5,331,656

Click here to switch to the map view.

The map label for this gene is yciL [C]

Identifier: 86748296

GI number: 86748296

Start: 1343935

End: 1346289

Strand: Direct

Name: yciL [C]

Synonym: RPB_1171

Alternate gene names: 86748296

Gene position: 1343935-1346289 (Clockwise)

Preceding gene: 86748293

Following gene: 86748297

Centisome position: 25.21

GC content: 72.4

Gene sequence:

>2355_bases
ATGCCCCGCGACACCGACAAAAACAACGCTTCCGCGCGGGGTCGCCGCGATCGGCCCGGCGCCGGCAAGGGCGCTTCCGG
CGGCAAAGGCGCTTCCGGCGGGAAGGGCGGCTTCGGCGGCAAAGGCGCGGGCGGCAAGGGGCCGGGCGGCGGCAAGAGTG
CCTCCGGCGGCAAGGGCCGGTCCGGCGCGGCGCGCGGCCCGGAGAAGAAATTCGCCAAGCGCGGCGAGGCTTATGAGCCC
CGCGGCGACAAGCCTTTTGCCAAAAAAGCGCCCGGCGGCGACGCCAAGCGCAGCTTCGGCGGCGAGGGCAAGCGGCCCTA
CGTGAAGCGCGAGGGTGCTGCGCCGCGCCGCGATTTCGAGGCTCGGCCGCGCCGCGACGACGGCGACGCGCCGCGTCCGC
GTTTCAACCGCGACGAGCGCCCCGCGCGCAGCGGCGGCGACCGTCCCGAGCGCGGTCCGCGCAAGGAGTTCGGCGACAAG
CGCTCGTTCGCGCCGCGCGAGGGCGGCGACAAACGGCCCTATACGCCGCGCGCCGACCGCGGTGACGGCGCCCGTCCGGC
AGGCCGGTTCGGCGACAAGAAATTCGGCGACCGCAAGCCCTATGCCTCGCGGGAAGGCGGCGAAAAACGCCCGTATACGC
CCCGCGAGGGTGGCGACAAGCGGCCCTATACGCCGCGCGAAGGCGGTGGCGAGAAGCGTCCTTACGCCGCCCGCGCCGGC
GGCGAGAAGCGCTCTTATGCGCCGCGCGGGGATGGTGAGAAGCGGCCCTATACGCCCCGCGCAGGTGGCGACAAGCGGCC
TTACGCGGCCCGCGACGGCGGCGGCGAGAAGCGCGCTTACGCACAGCGCGGGGACGGCGAGAAGCGTCCCTATACGCCGC
GCGAAGGCGGCGACAAGCGCCCGTTCAAGCCGCGCGAGGGCGGCGATCGGAAATTCGGCCGCGGCGCCCCGGATCGTGGC
CCGCGCAAGGAGTTCGGCAGCCGTCCGGATCGCGGGGCCGATCGCGGCGAATCCAAGCCTTGGCAGAAGCGCGACGGCGC
CTCCGCCGAGCGCAGCGAGCGCGGCCCGCGCAGCTTCGACAAGCCGCGGTTCGACAAGCCGCGCGAGGATCGCGGTGGCG
ATCGTCCCAAGTTCGAACGCCGCGAACGGTCGGGCGACTGGCACGAACATCCGCGCAGCGAGACCCGTTCGGCCGATCGT
CCGCGCAGCCGCGACGCCGGCGAACGCGGTTTCGACCGGCCGCGCCGCGCCAACGAGGACGACACCAAGATTTTCGCCAA
GCGCCCGGCCTTCGGCGGCCGCGGCGCCTATCGCGAGCGGCCGAAGACCGAGCCGAAGAAGGAACGTCGCGCGCCGCCGG
CGGCGAGAGCCGACGACAAGACCGGCGATCGCATCGCCAAGGTGGTCGCCCGCGCCGGCCTGTGTTCGCGCCGCGACGCC
GAGACCTGGGTCACCGAGGGCCGCGTCGCGGTCAACGGCCTGGTGATCGACAGTCCGGCGCTCGACGTGATGCCCTCCGA
CGTCATCACCGTCGACGGCAAGCCGTTGCCGGAGCGCGAGCGCACGCGGCTGTTCCTGTATCACAAGCCGCGCGGGCTGA
TGACCACCCATGCCGATCCCGAGGGGCGGCCGACGGTGTTCGACAATCTGCCCGAAGACCTGCCGCGCCTGATCTCGATC
GGCCGGCTCGACTTCAACACCGAGGGCCTGCTGCTGCTGACCAATGACGGCGGGCTGGCGCGCGCGCTCGAACTGCCGGA
GACCGGCTGGCTGCGGCGCTACCGCGTCCGCGCCCATGGCGAAGTCACCCAGGCGCAGCTCGACGAGTTGAAGAACGGCA
TCGAGGTCGACGGCGTCAAATACGGCGAGATCGAAGCCAAGCTCGAACGCGACCAGGGCGCCAATGTCTGGCTGGTGTTC
GCGATCCGCGAAGGCAAGAACCGCGAAGTCCGCAACGTGCTGGCGCATCTCGGCCTCGAGGTGAACCGGCTGATCCGGGT
CTCCTACGGCCCGTTCCAGTTGCTGGAGATCGAGGAAGGCGAGGTCGAGGAGGTCAAGACGCGGGTGCTGCGCGAGCAGC
TCGGCGACAAGATCATCCAGCTCGCGGGCGCCGATTTCGGCGGGCCGTCGCCGAGCGAGGCGCGGCCGAAGCCGCGTCCG
GGCAGGCCCGTCGCTGCTGCCGAGGCGGCGCCGGCGCCGAAGAAGAAAGCCCCGACCAAGCGCGGCGCGGTCGAGGACCG
CAAGGGCCGCAAGGTCAAGGTCGAGCGCACCGGCAGCGGCGGCGACCGGGGCCTCACCCGCGGCCCCGCCCGGCGCTATC
ACGGCAAGCGCGAACCGGCACCTCGCGAGGACTAA

Upstream 100 bases:

>100_bases
TGCGCCTTCGTCGAGAGCGCCCGTCAACGTCGTGTGAGCCCGTTCCCGACCGCCTGAGTCCCATTTCCGATCCCGGACGG
ATCCTGCAGAAAGACCAGTC

Downstream 100 bases:

>100_bases
CCGATGCGCGTGATCGGCGGGCGGCTGCGGGGCCGCAATCTGGTGGCGCCGTCGTCGCGCGACATCCGCCCGACGGCGGA
TCGGCTGCGCGAGTCGCTGT

Product: pseudouridine synthase Rsu

Products: NA

Alternate protein names: RNA pseudouridylate synthase; RNA-uridine isomerase [H]

Number of amino acids: Translated: 784; Mature: 783

Protein sequence:

>784_residues
MPRDTDKNNASARGRRDRPGAGKGASGGKGASGGKGGFGGKGAGGKGPGGGKSASGGKGRSGAARGPEKKFAKRGEAYEP
RGDKPFAKKAPGGDAKRSFGGEGKRPYVKREGAAPRRDFEARPRRDDGDAPRPRFNRDERPARSGGDRPERGPRKEFGDK
RSFAPREGGDKRPYTPRADRGDGARPAGRFGDKKFGDRKPYASREGGEKRPYTPREGGDKRPYTPREGGGEKRPYAARAG
GEKRSYAPRGDGEKRPYTPRAGGDKRPYAARDGGGEKRAYAQRGDGEKRPYTPREGGDKRPFKPREGGDRKFGRGAPDRG
PRKEFGSRPDRGADRGESKPWQKRDGASAERSERGPRSFDKPRFDKPREDRGGDRPKFERRERSGDWHEHPRSETRSADR
PRSRDAGERGFDRPRRANEDDTKIFAKRPAFGGRGAYRERPKTEPKKERRAPPAARADDKTGDRIAKVVARAGLCSRRDA
ETWVTEGRVAVNGLVIDSPALDVMPSDVITVDGKPLPERERTRLFLYHKPRGLMTTHADPEGRPTVFDNLPEDLPRLISI
GRLDFNTEGLLLLTNDGGLARALELPETGWLRRYRVRAHGEVTQAQLDELKNGIEVDGVKYGEIEAKLERDQGANVWLVF
AIREGKNREVRNVLAHLGLEVNRLIRVSYGPFQLLEIEEGEVEEVKTRVLREQLGDKIIQLAGADFGGPSPSEARPKPRP
GRPVAAAEAAPAPKKKAPTKRGAVEDRKGRKVKVERTGSGGDRGLTRGPARRYHGKREPAPRED

Sequences:

>Translated_784_residues
MPRDTDKNNASARGRRDRPGAGKGASGGKGASGGKGGFGGKGAGGKGPGGGKSASGGKGRSGAARGPEKKFAKRGEAYEP
RGDKPFAKKAPGGDAKRSFGGEGKRPYVKREGAAPRRDFEARPRRDDGDAPRPRFNRDERPARSGGDRPERGPRKEFGDK
RSFAPREGGDKRPYTPRADRGDGARPAGRFGDKKFGDRKPYASREGGEKRPYTPREGGDKRPYTPREGGGEKRPYAARAG
GEKRSYAPRGDGEKRPYTPRAGGDKRPYAARDGGGEKRAYAQRGDGEKRPYTPREGGDKRPFKPREGGDRKFGRGAPDRG
PRKEFGSRPDRGADRGESKPWQKRDGASAERSERGPRSFDKPRFDKPREDRGGDRPKFERRERSGDWHEHPRSETRSADR
PRSRDAGERGFDRPRRANEDDTKIFAKRPAFGGRGAYRERPKTEPKKERRAPPAARADDKTGDRIAKVVARAGLCSRRDA
ETWVTEGRVAVNGLVIDSPALDVMPSDVITVDGKPLPERERTRLFLYHKPRGLMTTHADPEGRPTVFDNLPEDLPRLISI
GRLDFNTEGLLLLTNDGGLARALELPETGWLRRYRVRAHGEVTQAQLDELKNGIEVDGVKYGEIEAKLERDQGANVWLVF
AIREGKNREVRNVLAHLGLEVNRLIRVSYGPFQLLEIEEGEVEEVKTRVLREQLGDKIIQLAGADFGGPSPSEARPKPRP
GRPVAAAEAAPAPKKKAPTKRGAVEDRKGRKVKVERTGSGGDRGLTRGPARRYHGKREPAPRED
>Mature_783_residues
PRDTDKNNASARGRRDRPGAGKGASGGKGASGGKGGFGGKGAGGKGPGGGKSASGGKGRSGAARGPEKKFAKRGEAYEPR
GDKPFAKKAPGGDAKRSFGGEGKRPYVKREGAAPRRDFEARPRRDDGDAPRPRFNRDERPARSGGDRPERGPRKEFGDKR
SFAPREGGDKRPYTPRADRGDGARPAGRFGDKKFGDRKPYASREGGEKRPYTPREGGDKRPYTPREGGGEKRPYAARAGG
EKRSYAPRGDGEKRPYTPRAGGDKRPYAARDGGGEKRAYAQRGDGEKRPYTPREGGDKRPFKPREGGDRKFGRGAPDRGP
RKEFGSRPDRGADRGESKPWQKRDGASAERSERGPRSFDKPRFDKPREDRGGDRPKFERRERSGDWHEHPRSETRSADRP
RSRDAGERGFDRPRRANEDDTKIFAKRPAFGGRGAYRERPKTEPKKERRAPPAARADDKTGDRIAKVVARAGLCSRRDAE
TWVTEGRVAVNGLVIDSPALDVMPSDVITVDGKPLPERERTRLFLYHKPRGLMTTHADPEGRPTVFDNLPEDLPRLISIG
RLDFNTEGLLLLTNDGGLARALELPETGWLRRYRVRAHGEVTQAQLDELKNGIEVDGVKYGEIEAKLERDQGANVWLVFA
IREGKNREVRNVLAHLGLEVNRLIRVSYGPFQLLEIEEGEVEEVKTRVLREQLGDKIIQLAGADFGGPSPSEARPKPRPG
RPVAAAEAAPAPKKKAPTKRGAVEDRKGRKVKVERTGSGGDRGLTRGPARRYHGKREPAPRED

Specific function: Unknown

COG id: COG1187

COG function: function code J; 16S rRNA uridine-516 pseudouridylate synthase and related pseudouridylate synthases

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 S4 RNA-binding domain [H]

Homologues:

Organism=Escherichia coli, GI1787524, Length=220, Percent_Identity=40.9090909090909, Blast_Score=140, Evalue=3e-34,
Organism=Escherichia coli, GI87081838, Length=186, Percent_Identity=34.4086021505376, Blast_Score=85, Evalue=2e-17,
Organism=Escherichia coli, GI1790453, Length=223, Percent_Identity=30.0448430493274, Blast_Score=75, Evalue=1e-14,
Organism=Escherichia coli, GI1788510, Length=181, Percent_Identity=29.8342541436464, Blast_Score=68, Evalue=2e-12,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR020103
- InterPro:   IPR006145
- InterPro:   IPR018496
- InterPro:   IPR002942 [H]

Pfam domain/function: PF00849 PseudoU_synth_2; PF01479 S4 [H]

EC number: NA

Molecular weight: Translated: 86359; Mature: 86228

Theoretical pI: Translated: 11.04; Mature: 11.04

Prosite motif: PS50889 S4 ; PS01149 PSI_RSU

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.1 %Cys     (Translated Protein)
0.4 %Met     (Translated Protein)
0.5 %Cys+Met (Translated Protein)
0.1 %Cys     (Mature Protein)
0.3 %Met     (Mature Protein)
0.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MPRDTDKNNASARGRRDRPGAGKGASGGKGASGGKGGFGGKGAGGKGPGGGKSASGGKGR
CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC
SGAARGPEKKFAKRGEAYEPRGDKPFAKKAPGGDAKRSFGGEGKRPYVKREGAAPRRDFE
CCCCCCCHHHHHHCCCCCCCCCCCCHHHCCCCCCHHHHCCCCCCCCCCCCCCCCCCCCCC
ARPRRDDGDAPRPRFNRDERPARSGGDRPERGPRKEFGDKRSFAPREGGDKRPYTPRADR
CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHHCCCCCCCCCCCCCCCCCCCCCCC
GDGARPAGRFGDKKFGDRKPYASREGGEKRPYTPREGGDKRPYTPREGGGEKRPYAARAG
CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHCC
GEKRSYAPRGDGEKRPYTPRAGGDKRPYAARDGGGEKRAYAQRGDGEKRPYTPREGGDKR
CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHCCCCCCCCCCCCCCCCCC
PFKPREGGDRKFGRGAPDRGPRKEFGSRPDRGADRGESKPWQKRDGASAERSERGPRSFD
CCCCCCCCCCCCCCCCCCCCCHHHHCCCCCCCCCCCCCCCCHHCCCCCHHHHHCCCCCCC
KPRFDKPREDRGGDRPKFERRERSGDWHEHPRSETRSADRPRSRDAGERGFDRPRRANED
CCCCCCCCHHCCCCCCHHHHHHCCCCHHHCCCHHHHCCCCCCCCCCCCCCCCCCCCCCCC
DTKIFAKRPAFGGRGAYRERPKTEPKKERRAPPAARADDKTGDRIAKVVARAGLCSRRDA
HHEEEEECCCCCCCCCCCCCCCCCCHHHHCCCCCCCCCCCHHHHHHHHHHHHCCCCCCCC
ETWVTEGRVAVNGLVIDSPALDVMPSDVITVDGKPLPERERTRLFLYHKPRGLMTTHADP
HHHHHCCEEEEEEEEECCCCCCCCCCCEEEECCCCCCCCCCCEEEEEECCCCCEECCCCC
EGRPTVFDNLPEDLPRLISIGRLDFNTEGLLLLTNDGGLARALELPETGWLRRYRVRAHG
CCCCCHHHCCHHHHHHHHHHCCCCCCCCCEEEEECCCCCEEEECCCCCHHHHHHHHHHCC
EVTQAQLDELKNGIEVDGVKYGEIEAKLERDQGANVWLVFAIREGKNREVRNVLAHLGLE
CHHHHHHHHHHCCCEECCEEECCCHHHHHHCCCCCEEEEEEECCCCCHHHHHHHHHHCCC
VNRLIRVSYGPFQLLEIEEGEVEEVKTRVLREQLGDKIIQLAGADFGGPSPSEARPKPRP
EEEEEEECCCCEEEEECCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCC
GRPVAAAEAAPAPKKKAPTKRGAVEDRKGRKVKVERTGSGGDRGLTRGPARRYHGKREPA
CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCEEEEEECCCCCCCCCCCCCHHHHCCCCCCC
PRED
CCCC
>Mature Secondary Structure 
PRDTDKNNASARGRRDRPGAGKGASGGKGASGGKGGFGGKGAGGKGPGGGKSASGGKGR
CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC
SGAARGPEKKFAKRGEAYEPRGDKPFAKKAPGGDAKRSFGGEGKRPYVKREGAAPRRDFE
CCCCCCCHHHHHHCCCCCCCCCCCCHHHCCCCCCHHHHCCCCCCCCCCCCCCCCCCCCCC
ARPRRDDGDAPRPRFNRDERPARSGGDRPERGPRKEFGDKRSFAPREGGDKRPYTPRADR
CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHHCCCCCCCCCCCCCCCCCCCCCCC
GDGARPAGRFGDKKFGDRKPYASREGGEKRPYTPREGGDKRPYTPREGGGEKRPYAARAG
CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHCC
GEKRSYAPRGDGEKRPYTPRAGGDKRPYAARDGGGEKRAYAQRGDGEKRPYTPREGGDKR
CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHCCCCCCCCCCCCCCCCCC
PFKPREGGDRKFGRGAPDRGPRKEFGSRPDRGADRGESKPWQKRDGASAERSERGPRSFD
CCCCCCCCCCCCCCCCCCCCCHHHHCCCCCCCCCCCCCCCCHHCCCCCHHHHHCCCCCCC
KPRFDKPREDRGGDRPKFERRERSGDWHEHPRSETRSADRPRSRDAGERGFDRPRRANED
CCCCCCCCHHCCCCCCHHHHHHCCCCHHHCCCHHHHCCCCCCCCCCCCCCCCCCCCCCCC
DTKIFAKRPAFGGRGAYRERPKTEPKKERRAPPAARADDKTGDRIAKVVARAGLCSRRDA
HHEEEEECCCCCCCCCCCCCCCCCCHHHHCCCCCCCCCCCHHHHHHHHHHHHCCCCCCCC
ETWVTEGRVAVNGLVIDSPALDVMPSDVITVDGKPLPERERTRLFLYHKPRGLMTTHADP
HHHHHCCEEEEEEEEECCCCCCCCCCCEEEECCCCCCCCCCCEEEEEECCCCCEECCCCC
EGRPTVFDNLPEDLPRLISIGRLDFNTEGLLLLTNDGGLARALELPETGWLRRYRVRAHG
CCCCCHHHCCHHHHHHHHHHCCCCCCCCCEEEEECCCCCEEEECCCCCHHHHHHHHHHCC
EVTQAQLDELKNGIEVDGVKYGEIEAKLERDQGANVWLVFAIREGKNREVRNVLAHLGLE
CHHHHHHHHHHCCCEECCEEECCCHHHHHHCCCCCEEEEEEECCCCCHHHHHHHHHHCCC
VNRLIRVSYGPFQLLEIEEGEVEEVKTRVLREQLGDKIIQLAGADFGGPSPSEARPKPRP
EEEEEEECCCCEEEEECCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCC
GRPVAAAEAAPAPKKKAPTKRGAVEDRKGRKVKVERTGSGGDRGLTRGPARRYHGKREPA
CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCEEEEEECCCCCCCCCCCCCHHHHCCCCCCC
PRED
CCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA