Definition Sphingopyxis alaskensis RB2256, complete genome.
Accession NC_008048
Length 3,345,170

Click here to switch to the map view.

The map label for this gene is yciR [C]

Identifier: 103487777

GI number: 103487777

Start: 2422439

End: 2424793

Strand: Direct

Name: yciR [C]

Synonym: Sala_2296

Alternate gene names: 103487777

Gene position: 2422439-2424793 (Clockwise)

Preceding gene: 103487776

Following gene: 103487778

Centisome position: 72.42

GC content: 67.35

Gene sequence:

>2355_bases
GTGAAAAGCCTGCCGACCGACCTGACTGCCGCCGACGTCATTCCCGCGCGGACCCTGCTGGGGCTGGGGCCGCGGGATCA
GGACATCGGAAACCTCCACCAGCTTCAGCTCGCGCCGCTTCGCGGCCGCGGATCGCTGCGTCTGGCGATGGGCATCGGCA
TGGCGCTCGTCGCCTTTCTGACGATGCTCCACCATGTCGCGCTGCCGGTCGCGGGCGGCTGGCTCGCCGGGTCGCTGCTT
TTCAGCCTGTGGTCCTACAGCCGGTTCCGCAACCTGCCGCTCGGCGATCCGAAACTTCCGGGAAGCGCCGAATATCGCAT
GTGCAACCGGCACGCGCTCTATTCGGCGCTGCTCTGGGGCCTGCCCTTCTGGCTTCAGGGGCTCGCGCCCGGCGTCGACC
ATATATTGTCGATGTGGACGATCGCGGTGCTGATGATGCTGACGCTGGCGATCGTCGCGCACAGCGTTCCGCTCGCCTGC
GCCCTGTTCATCATGCCTGTCTCGCTGTCGGCGGCAGCGGCGCTGGGGCTTGCCGGCGCGCCGGAAATCGCCGCGGTCAC
GCTCGTCGCGGGCATCCTGCTTTCGGCCTTCTGCGTCCGCTTCGCGCAAATCCATATCCGCTCGCGCCGCGCGGAAGAGA
CGCTGCACGAAAAGAGCGAGACGGTCAGCCTGCTGCTGCGCGAGTTCGAGGAAACCTCGGCCGACTGGCTGTGGCAGACC
GACAGCAACCGCCGCCTCGTCCACGTCTCGCCGCGCCTCGCCTATGCGCTCGGCGGCACCGCCGAGGGGCTTGAAGGCAT
TCCGCTGCTGCAGGCGCTGTCGGGCGACGCTTGGGAAACCGGGCTGTTCCCCAAGAGCCTGCACGACATGGCCGAACGGA
TGAAGCGGCGCGAGAGCTTCTCGAACCTGATCGTTCCCGTGTCGATCGACGGTCGTCCGCGCTGGTGGGAATTGTCGGCG
TCGCCGCGGCTCGACGAATCGGGCAGGTTTCTGGGGTTTCGCGGGGTCGGGTCCGACGTCACCGAACAGCGCGCGACCGC
CGAACAAATCGCCCGGATGGCGCGATTCGACAATCTCACCGGTCTGCCCAACCGGCTCAGCCTCAACGAGGATCTCGCGC
GGGCGCTCACCCGCGCCATCGAGGCGAAGTCGCGCTGCGCGCTGCTGATGATCGACCTCGACCGCTTCAAGGCGGTCAAT
GATACGCTGGGGCATCCCGTCGGCGACAAATTGCTCGCGCAGGTCGCCGCGCGCCTCAAAGGGTTGATGGAGCGCGGCAT
GACCTGCGGCCGCCTTGGCGGCGACGAGTTTGCCGTCGTGCTGCACAATCTCTCCTCGCCCGCCGTCGCCGAGGATCTGG
CGCAGCGGATCATCGCGACGATCAGCCGGCCCTATGTCGTCGACAATCATCAATTGTTCGTCGGCGCCAGCGTCGGTTAT
GCGATCGGCCCGACCGACGGCGCGACGGTCGAGACGCTCACCCGCAACGCCGACCTGGCGCTCTATAAATCGAAGGACCG
CGGCGGCAATGTCGTCGCCGCCTATGTCGCCTCGCTCCACGCGCAGGCCGAGGAACGGCGCGTGATGGAGCAGGAATTGC
GCGGCGCGCTGGAACGCGGCGAGTTCGAGCTTTATTACCAGCCCGTCGTCACCGCCGCCGACGGCACGCTCAACGGCTTC
GAGGCGCTGATCCGCTGGACCAACCACAAGCTCGGCAATGTCTCGCCCGGCCGCTTCATCCCGATCGCCGAGGACGCGCG
CCTCATCTCGCCGATCGGCGAATGGGTGCTGCGCACCGCGTGCCACGAGGCGATGAAATGGCCGTCGAACCTGAAGGTCG
CGGTCAACGTGTCGGCCGACCAGCTCACCGATCCCAGCTTCGCCTCGGTCGTCGTTTCGGCGCTCGCACAGAGCGGGCTT
TCGCCGCAAAGGCTGGAGATCGAAGTCACCGAAAGCGTCTTCCTGCGCGACGGCGGCGGCGCGGCGCAGCTGCTCGACCA
GCTCATCGGGCTGGGCATCCGGCTGTCGCTCGACGATTTCGGGACGGGCTATTCCTCGCTCGGCTATCTGCGCAAGACCC
AGTTCTCGACGATCAAGGTCGACCGCAGCTTCGTCGTCGGCGCCGCGAAGGGCAGCATCGAATCGATCGCGATCATCCGC
GCGGTCGTCGCGCTCGCCGACAGCCTCGGCATGTCGACCACCGCCGAGGGTGCGGAGACCGAGCTCGAGGTCGAAACGCT
GCGCAGCTTCGGCTGCTCGAACATCCAGGGCTATTATTACGGGCGCCCGATGCCCGCGAGCGATGTGCTGACGCTGTTCC
GCCGCCCCGACGACGTGGCGATCGCCGCGGCGTGA

Upstream 100 bases:

>100_bases
CCCACGCAATCCTCCATCCTGTCCCCGCCCGGCACATCTATTCGCGGCCAGACGGTCCGATGGTTACCTTCGGGTAACCC
GCACCCGCTACACGGGGCGG

Downstream 100 bases:

>100_bases
CGATCGTCGCCCCCGCGAAGGCGGGGCCGCCGTCAGCCTTGCGCGGCCAGCCGAATACTCCGCACGACGAATCGAATGTC
CTGCCAAAAGGTTCCCCGGT

Product: diguanylate cyclase/phosphodiesterase with PAS/PAC sensor(s)

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 784; Mature: 784

Protein sequence:

>784_residues
MKSLPTDLTAADVIPARTLLGLGPRDQDIGNLHQLQLAPLRGRGSLRLAMGIGMALVAFLTMLHHVALPVAGGWLAGSLL
FSLWSYSRFRNLPLGDPKLPGSAEYRMCNRHALYSALLWGLPFWLQGLAPGVDHILSMWTIAVLMMLTLAIVAHSVPLAC
ALFIMPVSLSAAAALGLAGAPEIAAVTLVAGILLSAFCVRFAQIHIRSRRAEETLHEKSETVSLLLREFEETSADWLWQT
DSNRRLVHVSPRLAYALGGTAEGLEGIPLLQALSGDAWETGLFPKSLHDMAERMKRRESFSNLIVPVSIDGRPRWWELSA
SPRLDESGRFLGFRGVGSDVTEQRATAEQIARMARFDNLTGLPNRLSLNEDLARALTRAIEAKSRCALLMIDLDRFKAVN
DTLGHPVGDKLLAQVAARLKGLMERGMTCGRLGGDEFAVVLHNLSSPAVAEDLAQRIIATISRPYVVDNHQLFVGASVGY
AIGPTDGATVETLTRNADLALYKSKDRGGNVVAAYVASLHAQAEERRVMEQELRGALERGEFELYYQPVVTAADGTLNGF
EALIRWTNHKLGNVSPGRFIPIAEDARLISPIGEWVLRTACHEAMKWPSNLKVAVNVSADQLTDPSFASVVVSALAQSGL
SPQRLEIEVTESVFLRDGGGAAQLLDQLIGLGIRLSLDDFGTGYSSLGYLRKTQFSTIKVDRSFVVGAAKGSIESIAIIR
AVVALADSLGMSTTAEGAETELEVETLRSFGCSNIQGYYYGRPMPASDVLTLFRRPDDVAIAAA

Sequences:

>Translated_784_residues
MKSLPTDLTAADVIPARTLLGLGPRDQDIGNLHQLQLAPLRGRGSLRLAMGIGMALVAFLTMLHHVALPVAGGWLAGSLL
FSLWSYSRFRNLPLGDPKLPGSAEYRMCNRHALYSALLWGLPFWLQGLAPGVDHILSMWTIAVLMMLTLAIVAHSVPLAC
ALFIMPVSLSAAAALGLAGAPEIAAVTLVAGILLSAFCVRFAQIHIRSRRAEETLHEKSETVSLLLREFEETSADWLWQT
DSNRRLVHVSPRLAYALGGTAEGLEGIPLLQALSGDAWETGLFPKSLHDMAERMKRRESFSNLIVPVSIDGRPRWWELSA
SPRLDESGRFLGFRGVGSDVTEQRATAEQIARMARFDNLTGLPNRLSLNEDLARALTRAIEAKSRCALLMIDLDRFKAVN
DTLGHPVGDKLLAQVAARLKGLMERGMTCGRLGGDEFAVVLHNLSSPAVAEDLAQRIIATISRPYVVDNHQLFVGASVGY
AIGPTDGATVETLTRNADLALYKSKDRGGNVVAAYVASLHAQAEERRVMEQELRGALERGEFELYYQPVVTAADGTLNGF
EALIRWTNHKLGNVSPGRFIPIAEDARLISPIGEWVLRTACHEAMKWPSNLKVAVNVSADQLTDPSFASVVVSALAQSGL
SPQRLEIEVTESVFLRDGGGAAQLLDQLIGLGIRLSLDDFGTGYSSLGYLRKTQFSTIKVDRSFVVGAAKGSIESIAIIR
AVVALADSLGMSTTAEGAETELEVETLRSFGCSNIQGYYYGRPMPASDVLTLFRRPDDVAIAAA
>Mature_784_residues
MKSLPTDLTAADVIPARTLLGLGPRDQDIGNLHQLQLAPLRGRGSLRLAMGIGMALVAFLTMLHHVALPVAGGWLAGSLL
FSLWSYSRFRNLPLGDPKLPGSAEYRMCNRHALYSALLWGLPFWLQGLAPGVDHILSMWTIAVLMMLTLAIVAHSVPLAC
ALFIMPVSLSAAAALGLAGAPEIAAVTLVAGILLSAFCVRFAQIHIRSRRAEETLHEKSETVSLLLREFEETSADWLWQT
DSNRRLVHVSPRLAYALGGTAEGLEGIPLLQALSGDAWETGLFPKSLHDMAERMKRRESFSNLIVPVSIDGRPRWWELSA
SPRLDESGRFLGFRGVGSDVTEQRATAEQIARMARFDNLTGLPNRLSLNEDLARALTRAIEAKSRCALLMIDLDRFKAVN
DTLGHPVGDKLLAQVAARLKGLMERGMTCGRLGGDEFAVVLHNLSSPAVAEDLAQRIIATISRPYVVDNHQLFVGASVGY
AIGPTDGATVETLTRNADLALYKSKDRGGNVVAAYVASLHAQAEERRVMEQELRGALERGEFELYYQPVVTAADGTLNGF
EALIRWTNHKLGNVSPGRFIPIAEDARLISPIGEWVLRTACHEAMKWPSNLKVAVNVSADQLTDPSFASVVVSALAQSGL
SPQRLEIEVTESVFLRDGGGAAQLLDQLIGLGIRLSLDDFGTGYSSLGYLRKTQFSTIKVDRSFVVGAAKGSIESIAIIR
AVVALADSLGMSTTAEGAETELEVETLRSFGCSNIQGYYYGRPMPASDVLTLFRRPDDVAIAAA

Specific function: Unknown

COG id: COG5001

COG function: function code T; Predicted signal transduction protein containing a membrane domain, an EAL and a GGDEF domain

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 2 PAS (PER-ARNT-SIM) domains [H]

Homologues:

Organism=Escherichia coli, GI1787541, Length=442, Percent_Identity=33.710407239819, Blast_Score=259, Evalue=4e-70,
Organism=Escherichia coli, GI87081921, Length=433, Percent_Identity=30.9468822170901, Blast_Score=215, Evalue=9e-57,
Organism=Escherichia coli, GI226510982, Length=455, Percent_Identity=29.010989010989, Blast_Score=169, Evalue=8e-43,
Organism=Escherichia coli, GI87081845, Length=247, Percent_Identity=35.2226720647773, Blast_Score=144, Evalue=3e-35,
Organism=Escherichia coli, GI1788502, Length=250, Percent_Identity=32, Blast_Score=137, Evalue=2e-33,
Organism=Escherichia coli, GI1787055, Length=254, Percent_Identity=34.6456692913386, Blast_Score=137, Evalue=2e-33,
Organism=Escherichia coli, GI87081980, Length=248, Percent_Identity=32.258064516129, Blast_Score=130, Evalue=3e-31,
Organism=Escherichia coli, GI1790496, Length=239, Percent_Identity=30.9623430962343, Blast_Score=129, Evalue=9e-31,
Organism=Escherichia coli, GI1786507, Length=240, Percent_Identity=32.9166666666667, Blast_Score=127, Evalue=4e-30,
Organism=Escherichia coli, GI1788849, Length=444, Percent_Identity=27.027027027027, Blast_Score=126, Evalue=5e-30,
Organism=Escherichia coli, GI87081743, Length=250, Percent_Identity=29.6, Blast_Score=126, Evalue=5e-30,
Organism=Escherichia coli, GI87082096, Length=425, Percent_Identity=24.7058823529412, Blast_Score=117, Evalue=4e-27,
Organism=Escherichia coli, GI1788381, Length=562, Percent_Identity=23.6654804270463, Blast_Score=107, Evalue=4e-24,
Organism=Escherichia coli, GI1788956, Length=194, Percent_Identity=32.9896907216495, Blast_Score=95, Evalue=2e-20,
Organism=Escherichia coli, GI87081977, Length=181, Percent_Identity=33.7016574585635, Blast_Score=93, Evalue=7e-20,
Organism=Escherichia coli, GI87081881, Length=176, Percent_Identity=30.6818181818182, Blast_Score=80, Evalue=5e-16,
Organism=Escherichia coli, GI1786584, Length=178, Percent_Identity=34.2696629213483, Blast_Score=77, Evalue=4e-15,
Organism=Escherichia coli, GI87081974, Length=161, Percent_Identity=32.2981366459627, Blast_Score=75, Evalue=2e-14,
Organism=Escherichia coli, GI1787802, Length=168, Percent_Identity=29.1666666666667, Blast_Score=74, Evalue=3e-14,
Organism=Escherichia coli, GI145693134, Length=189, Percent_Identity=32.2751322751323, Blast_Score=73, Evalue=6e-14,
Organism=Escherichia coli, GI1787262, Length=169, Percent_Identity=30.1775147928994, Blast_Score=71, Evalue=3e-13,
Organism=Escherichia coli, GI87082007, Length=162, Percent_Identity=33.3333333333333, Blast_Score=70, Evalue=4e-13,
Organism=Escherichia coli, GI1789650, Length=439, Percent_Identity=23.9179954441913, Blast_Score=69, Evalue=9e-13,
Organism=Escherichia coli, GI1787816, Length=165, Percent_Identity=32.7272727272727, Blast_Score=64, Evalue=3e-11,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR001054
- InterPro:   IPR000160
- InterPro:   IPR001633
- InterPro:   IPR001610
- InterPro:   IPR000014
- InterPro:   IPR000700
- InterPro:   IPR013656
- InterPro:   IPR013655 [H]

Pfam domain/function: PF00563 EAL; PF00990 GGDEF; PF08447 PAS_3; PF08448 PAS_4 [H]

EC number: NA

Molecular weight: Translated: 84876; Mature: 84876

Theoretical pI: Translated: 6.62; Mature: 6.62

Prosite motif: PS50113 PAC ; PS50883 EAL ; PS50887 GGDEF ; PS00284 SERPIN

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.9 %Cys     (Translated Protein)
2.4 %Met     (Translated Protein)
3.3 %Cys+Met (Translated Protein)
0.9 %Cys     (Mature Protein)
2.4 %Met     (Mature Protein)
3.3 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKSLPTDLTAADVIPARTLLGLGPRDQDIGNLHQLQLAPLRGRGSLRLAMGIGMALVAFL
CCCCCCCCCHHHHHHHHHHHCCCCCCCCCCCEEEEEEEEECCCCCEEHHHHHHHHHHHHH
TMLHHVALPVAGGWLAGSLLFSLWSYSRFRNLPLGDPKLPGSAEYRMCNRHALYSALLWG
HHHHHHHHHCCCHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHH
LPFWLQGLAPGVDHILSMWTIAVLMMLTLAIVAHSVPLACALFIMPVSLSAAAALGLAGA
HHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCC
PEIAAVTLVAGILLSAFCVRFAQIHIRSRRAEETLHEKSETVSLLLREFEETSADWLWQT
CHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEEC
DSNRRLVHVSPRLAYALGGTAEGLEGIPLLQALSGDAWETGLFPKSLHDMAERMKRRESF
CCCCEEEEECCCCCEEECCCCCCCCCCHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHHHH
SNLIVPVSIDGRPRWWELSASPRLDESGRFLGFRGVGSDVTEQRATAEQIARMARFDNLT
CCEEEEEEECCCCCEEEECCCCCCCCCCCEEEEECCCCCHHHHHHHHHHHHHHHHHCCCC
GLPNRLSLNEDLARALTRAIEAKSRCALLMIDLDRFKAVNDTLGHPVGDKLLAQVAARLK
CCCCCCCCCHHHHHHHHHHHHHCCCEEEEEEEHHHHHHHHHHHCCCCHHHHHHHHHHHHH
GLMERGMTCGRLGGDEFAVVLHNLSSPAVAEDLAQRIIATISRPYVVDNHQLFVGASVGY
HHHHCCCCCCCCCCCHHEEEEECCCCCHHHHHHHHHHHHHHCCCEEECCCEEEEECCCCC
AIGPTDGATVETLTRNADLALYKSKDRGGNVVAAYVASLHAQAEERRVMEQELRGALERG
EECCCCCCCHHHHHCCCCEEEEECCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCC
EFELYYQPVVTAADGTLNGFEALIRWTNHKLGNVSPGRFIPIAEDARLISPIGEWVLRTA
CEEEEEECEEEECCCCHHHHHHHHHHHCCCCCCCCCCCEEECCCCCHHHHHHHHHHHHHH
CHEAMKWPSNLKVAVNVSADQLTDPSFASVVVSALAQSGLSPQRLEIEVTESVFLRDGGG
HHHHHCCCCCCEEEEEECHHHCCCCHHHHHHHHHHHHCCCCCCEEEEEEECEEEEECCCC
AAQLLDQLIGLGIRLSLDDFGTGYSSLGYLRKTQFSTIKVDRSFVVGAAKGSIESIAIIR
HHHHHHHHHCCCEEEEEHHCCCCHHHHHHHHHCCCCEEEECCCEEEEECCCCHHHHHHHH
AVVALADSLGMSTTAEGAETELEVETLRSFGCSNIQGYYYGRPMPASDVLTLFRRPDDVA
HHHHHHHHCCCCCCCCCCCCHHHHHHHHHCCCCCCCCEECCCCCCHHHHHHHHCCCCCEE
IAAA
EECC
>Mature Secondary Structure
MKSLPTDLTAADVIPARTLLGLGPRDQDIGNLHQLQLAPLRGRGSLRLAMGIGMALVAFL
CCCCCCCCCHHHHHHHHHHHCCCCCCCCCCCEEEEEEEEECCCCCEEHHHHHHHHHHHHH
TMLHHVALPVAGGWLAGSLLFSLWSYSRFRNLPLGDPKLPGSAEYRMCNRHALYSALLWG
HHHHHHHHHCCCHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHH
LPFWLQGLAPGVDHILSMWTIAVLMMLTLAIVAHSVPLACALFIMPVSLSAAAALGLAGA
HHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCC
PEIAAVTLVAGILLSAFCVRFAQIHIRSRRAEETLHEKSETVSLLLREFEETSADWLWQT
CHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEEC
DSNRRLVHVSPRLAYALGGTAEGLEGIPLLQALSGDAWETGLFPKSLHDMAERMKRRESF
CCCCEEEEECCCCCEEECCCCCCCCCCHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHHHH
SNLIVPVSIDGRPRWWELSASPRLDESGRFLGFRGVGSDVTEQRATAEQIARMARFDNLT
CCEEEEEEECCCCCEEEECCCCCCCCCCCEEEEECCCCCHHHHHHHHHHHHHHHHHCCCC
GLPNRLSLNEDLARALTRAIEAKSRCALLMIDLDRFKAVNDTLGHPVGDKLLAQVAARLK
CCCCCCCCCHHHHHHHHHHHHHCCCEEEEEEEHHHHHHHHHHHCCCCHHHHHHHHHHHHH
GLMERGMTCGRLGGDEFAVVLHNLSSPAVAEDLAQRIIATISRPYVVDNHQLFVGASVGY
HHHHCCCCCCCCCCCHHEEEEECCCCCHHHHHHHHHHHHHHCCCEEECCCEEEEECCCCC
AIGPTDGATVETLTRNADLALYKSKDRGGNVVAAYVASLHAQAEERRVMEQELRGALERG
EECCCCCCCHHHHHCCCCEEEEECCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCC
EFELYYQPVVTAADGTLNGFEALIRWTNHKLGNVSPGRFIPIAEDARLISPIGEWVLRTA
CEEEEEECEEEECCCCHHHHHHHHHHHCCCCCCCCCCCEEECCCCCHHHHHHHHHHHHHH
CHEAMKWPSNLKVAVNVSADQLTDPSFASVVVSALAQSGLSPQRLEIEVTESVFLRDGGG
HHHHHCCCCCCEEEEEECHHHCCCCHHHHHHHHHHHHCCCCCCEEEEEEECEEEEECCCC
AAQLLDQLIGLGIRLSLDDFGTGYSSLGYLRKTQFSTIKVDRSFVVGAAKGSIESIAIIR
HHHHHHHHHCCCEEEEEHHCCCCHHHHHHHHHCCCCEEEECCCEEEEECCCCHHHHHHHH
AVVALADSLGMSTTAEGAETELEVETLRSFGCSNIQGYYYGRPMPASDVLTLFRRPDDVA
HHHHHHHHCCCCCCCCCCCCHHHHHHHHHCCCCCCCCEECCCCCCHHHHHHHHCCCCCEE
IAAA
EECC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 9163424 [H]