| Definition | Rhodospirillum rubrum ATCC 11170 chromosome, complete genome. |
|---|---|
| Accession | NC_007643 |
| Length | 4,352,825 |
Click here to switch to the map view.
The map label for this gene is ykoW [H]
Identifier: 83593936
GI number: 83593936
Start: 3027678
End: 3029714
Strand: Reverse
Name: ykoW [H]
Synonym: Rru_A2604
Alternate gene names: 83593936
Gene position: 3029714-3027678 (Counterclockwise)
Preceding gene: 83593937
Following gene: 83593933
Centisome position: 69.6
GC content: 62.64
Gene sequence:
>2037_bases GTGCTCGGAAAATTTCTCGCCGTTCAGCAGGCTTTGCGGGTCTCCCTGCTTAGCCTTGCGGTGTCTTTGGGATTTCTGGG CATGCAAACGGTCTGGCTGGCCAGCGCCGCCGACCGCGATTATCTGATCTTGCGCGATCGGACGGCCTCGTCCTTGCAAT CGGGGTTGTCGAACGCCCTGTGGAATTTCGATGCGGAAACCGCCAAGGCCATCATCAGCGATGCGCTGCGCGCCAATCCC ATTCGCTCCATTCACGTCATCGATTCCAATGGCCGGGTTTTCGCCGATGGCCAAAGCGCCCAGCCGGTCGTCGCGCCCTC CCTATGGGAAAGCTATCTGGGTTGGCTGGTCGATCTGAAAAGCGAGATGACCCTTGATCTGCGCTTTTCGAGCCCGACCG ACGACCATTACCAGGGGATGGTCGTCGGCTTCGTCTTTATCACCTTCGATAAGGACCATTTCATCCGGGGGATCGCCGAT CGACTGGCCGATCAGGTGCTTGGCATTCTGGTCATCGTGCTGGTGGTGGCCCTGACCACCAGCATCGTCTTCCACCTGTT CATCTCGCGGCCGATCATCCGCGTTGCCCGCGGCGTCGCCGATGTTGATCCCGAAGATCCCGCCGCCACGGTTTTGACCG TTCCCCGCGCCCATCAACGCAATGAAATCGGCCGCATGACCAACCGGCTCAATCATCTGTTGGGCCGGCTGGCCGAGGTG CAGGGGGAACTGCGGCTGTTGGCCACCCGCGATCCGCTGACCGATCTGCCCAACCGCAGCCTGATCCTTGAGATGATGGA CGCGACGATCAACCGGGTCGCCCTGGACGGTGGCCGCTGCGCGGTGATGTTTCTTGATCTCGACATGTTCAAGCACGTCA ACGACAGCCTGGGACACGAGGCGGGTGATCTCATCCTCAAGGACATCGGACGGCGGTTCGACGCGGTGGTCGCCGGCCTG GGGGCGGTGGGGCGGTTGGGCGGCGACGAGTTCGTCGTTCTCATTGACCGCTATGAGCGCGAAGACGATCTGGCCCGCAT CGCCCGCCGGCTGATCACCACGGTCAAACGGCCCATCGAGGTCGATGGCACCCTGGTCCATTCAAGCACCTCGGTCGGCA TCGCCTGTTATCCGGTCGATGGTGCCACCCCCCAGGGGCTGTTGCGCAATGCCGATACGGCGATGTATGCGGTCAAGGCG AGCGGGCCGGGCCAATGGGCGTTCTTCGACCGCTCGATGACCGAGAACGCCCTGGTGCGGCTGCGGACCGAGGCGTCCTT GCGCTCGGCGATCGAAAAGGGCCAATTCGTTTTGCACTATCAGCCCAAGCTTGATCTGCGCTCGAACCGTATCAGCGGCT GCGAGGCCTTGATCCGCTGGGACTTGAACGGAGATTTGGTGCCGCCGGGCCGCTTCATCTCGATCGCCGAGGAAACCGGC ATGATCTATGACATCGGGCTATGGGTGCTGCGCGAGGCCTGTCAGGCGCAACGGCGCTGGCGCCGCCACGCCGGCGCGGT GCCGATCGCCATCAATGTCTCGGTGCGCCAGCTCAAGGACGAGCGGTTCATCGACGATTTCCTCGATATCATCCAGGCGA GCGGCGCCGATCCCGAACTGCTGGAAGTCGAAGTGACCGAAAGCGCCCTGATGAGCAGCATCGAGGTCAGCGCCCATCTG CTGCGCGAGATGCGCAGCCATGGCGTTCGCCTGTCGATCGATGACTTTGGCACGGGGTATTCCTCGCTGGCCTATCTGAA GAACCTGCCCATCGATATCCTCAAGATCGACCGCAGTTTCGTCAGCGATCTGCCCGAGGAAAGCTCGATCCCGCGCATGA TCATCGGGCTTGCCGGCCAGATGGGACTGCGCACGGTGGCCGAGGGGATCGAGACCGAGGGGCAATTGGCCTGGCTGCGC GACAATGGCTGCGACATGATCCAGGGCTTCCTGATCGAAAAGCCGCTGCCCGAGGCCGACTTCCTCCGCTTCGTCGACGC CTATCGGACCGCACGGGCCTTCCCCTCGGCGTCTTGA
Upstream 100 bases:
>100_bases GTTAGAGTGGGGCTTGTGGTGGCGCCTGATCCGCGTCGCGGGGTCGGTGCGCGCGGTCGGGGGAAATCCAGGGATCTTTG ACACAGACGGGGGAGAACCG
Downstream 100 bases:
>100_bases GCGAAAATCTGCGGACCCGTCTCACCCGTGGTCGAGGCCGCGGGCCATGAGCACCGCCTGGGTGCGGTTGCCGGCGTCAA GCGCCTTCAAGATCCCGGTG
Product: diguanylate cyclase/phosphodiesterase
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 678; Mature: 678
Protein sequence:
>678_residues MLGKFLAVQQALRVSLLSLAVSLGFLGMQTVWLASAADRDYLILRDRTASSLQSGLSNALWNFDAETAKAIISDALRANP IRSIHVIDSNGRVFADGQSAQPVVAPSLWESYLGWLVDLKSEMTLDLRFSSPTDDHYQGMVVGFVFITFDKDHFIRGIAD RLADQVLGILVIVLVVALTTSIVFHLFISRPIIRVARGVADVDPEDPAATVLTVPRAHQRNEIGRMTNRLNHLLGRLAEV QGELRLLATRDPLTDLPNRSLILEMMDATINRVALDGGRCAVMFLDLDMFKHVNDSLGHEAGDLILKDIGRRFDAVVAGL GAVGRLGGDEFVVLIDRYEREDDLARIARRLITTVKRPIEVDGTLVHSSTSVGIACYPVDGATPQGLLRNADTAMYAVKA SGPGQWAFFDRSMTENALVRLRTEASLRSAIEKGQFVLHYQPKLDLRSNRISGCEALIRWDLNGDLVPPGRFISIAEETG MIYDIGLWVLREACQAQRRWRRHAGAVPIAINVSVRQLKDERFIDDFLDIIQASGADPELLEVEVTESALMSSIEVSAHL LREMRSHGVRLSIDDFGTGYSSLAYLKNLPIDILKIDRSFVSDLPEESSIPRMIIGLAGQMGLRTVAEGIETEGQLAWLR DNGCDMIQGFLIEKPLPEADFLRFVDAYRTARAFPSAS
Sequences:
>Translated_678_residues MLGKFLAVQQALRVSLLSLAVSLGFLGMQTVWLASAADRDYLILRDRTASSLQSGLSNALWNFDAETAKAIISDALRANP IRSIHVIDSNGRVFADGQSAQPVVAPSLWESYLGWLVDLKSEMTLDLRFSSPTDDHYQGMVVGFVFITFDKDHFIRGIAD RLADQVLGILVIVLVVALTTSIVFHLFISRPIIRVARGVADVDPEDPAATVLTVPRAHQRNEIGRMTNRLNHLLGRLAEV QGELRLLATRDPLTDLPNRSLILEMMDATINRVALDGGRCAVMFLDLDMFKHVNDSLGHEAGDLILKDIGRRFDAVVAGL GAVGRLGGDEFVVLIDRYEREDDLARIARRLITTVKRPIEVDGTLVHSSTSVGIACYPVDGATPQGLLRNADTAMYAVKA SGPGQWAFFDRSMTENALVRLRTEASLRSAIEKGQFVLHYQPKLDLRSNRISGCEALIRWDLNGDLVPPGRFISIAEETG MIYDIGLWVLREACQAQRRWRRHAGAVPIAINVSVRQLKDERFIDDFLDIIQASGADPELLEVEVTESALMSSIEVSAHL LREMRSHGVRLSIDDFGTGYSSLAYLKNLPIDILKIDRSFVSDLPEESSIPRMIIGLAGQMGLRTVAEGIETEGQLAWLR DNGCDMIQGFLIEKPLPEADFLRFVDAYRTARAFPSAS >Mature_678_residues MLGKFLAVQQALRVSLLSLAVSLGFLGMQTVWLASAADRDYLILRDRTASSLQSGLSNALWNFDAETAKAIISDALRANP IRSIHVIDSNGRVFADGQSAQPVVAPSLWESYLGWLVDLKSEMTLDLRFSSPTDDHYQGMVVGFVFITFDKDHFIRGIAD RLADQVLGILVIVLVVALTTSIVFHLFISRPIIRVARGVADVDPEDPAATVLTVPRAHQRNEIGRMTNRLNHLLGRLAEV QGELRLLATRDPLTDLPNRSLILEMMDATINRVALDGGRCAVMFLDLDMFKHVNDSLGHEAGDLILKDIGRRFDAVVAGL GAVGRLGGDEFVVLIDRYEREDDLARIARRLITTVKRPIEVDGTLVHSSTSVGIACYPVDGATPQGLLRNADTAMYAVKA SGPGQWAFFDRSMTENALVRLRTEASLRSAIEKGQFVLHYQPKLDLRSNRISGCEALIRWDLNGDLVPPGRFISIAEETG MIYDIGLWVLREACQAQRRWRRHAGAVPIAINVSVRQLKDERFIDDFLDIIQASGADPELLEVEVTESALMSSIEVSAHL LREMRSHGVRLSIDDFGTGYSSLAYLKNLPIDILKIDRSFVSDLPEESSIPRMIIGLAGQMGLRTVAEGIETEGQLAWLR DNGCDMIQGFLIEKPLPEADFLRFVDAYRTARAFPSAS
Specific function: Probable signaling protein whose physiological role is not yet known [H]
COG id: COG5001
COG function: function code T; Predicted signal transduction protein containing a membrane domain, an EAL and a GGDEF domain
Gene ontology:
Cell location: Cell membrane; Multi-pass membrane protein (Potential) [H]
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 1 PAS (PER-ARNT-SIM) domain [H]
Homologues:
Organism=Escherichia coli, GI1787541, Length=432, Percent_Identity=36.8055555555556, Blast_Score=290, Evalue=3e-79, Organism=Escherichia coli, GI226510982, Length=529, Percent_Identity=28.5444234404537, Blast_Score=241, Evalue=1e-64, Organism=Escherichia coli, GI87081921, Length=413, Percent_Identity=34.3825665859564, Blast_Score=217, Evalue=2e-57, Organism=Escherichia coli, GI87081743, Length=243, Percent_Identity=37.8600823045267, Blast_Score=160, Evalue=2e-40, Organism=Escherichia coli, GI1790496, Length=250, Percent_Identity=35.2, Blast_Score=154, Evalue=2e-38, Organism=Escherichia coli, GI1788502, Length=263, Percent_Identity=33.0798479087452, Blast_Score=142, Evalue=5e-35, Organism=Escherichia coli, GI1787055, Length=287, Percent_Identity=30.6620209059233, Blast_Score=135, Evalue=7e-33, Organism=Escherichia coli, GI87081845, Length=266, Percent_Identity=32.3308270676692, Blast_Score=131, Evalue=2e-31, Organism=Escherichia coli, GI87081980, Length=250, Percent_Identity=32, Blast_Score=123, Evalue=4e-29, Organism=Escherichia coli, GI1786507, Length=257, Percent_Identity=29.1828793774319, Blast_Score=119, Evalue=8e-28, Organism=Escherichia coli, GI1788849, Length=249, Percent_Identity=32.1285140562249, Blast_Score=111, Evalue=1e-25, Organism=Escherichia coli, GI87082096, Length=239, Percent_Identity=29.2887029288703, Blast_Score=100, Evalue=6e-22, Organism=Escherichia coli, GI1788381, Length=426, Percent_Identity=24.4131455399061, Blast_Score=94, Evalue=4e-20, Organism=Escherichia coli, GI87081977, Length=168, Percent_Identity=31.547619047619, Blast_Score=80, Evalue=3e-16, Organism=Escherichia coli, GI1788956, Length=167, Percent_Identity=32.3353293413174, Blast_Score=75, Evalue=2e-14, Organism=Escherichia coli, GI1786584, Length=169, Percent_Identity=28.4023668639053, Blast_Score=74, Evalue=3e-14, Organism=Escherichia coli, GI145693134, Length=156, Percent_Identity=30.7692307692308, Blast_Score=69, Evalue=7e-13, Organism=Escherichia coli, GI1787262, Length=169, Percent_Identity=28.4023668639053, Blast_Score=67, Evalue=4e-12, Organism=Escherichia coli, GI1787410, Length=222, Percent_Identity=26.5765765765766, Blast_Score=66, Evalue=8e-12, Organism=Escherichia coli, GI1787802, Length=220, Percent_Identity=27.2727272727273, Blast_Score=65, Evalue=1e-11,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR001054 - InterPro: IPR000160 - InterPro: IPR001633 - InterPro: IPR005330 - InterPro: IPR000014 [H]
Pfam domain/function: PF00563 EAL; PF00990 GGDEF; PF03707 MHYT [H]
EC number: NA
Molecular weight: Translated: 74940; Mature: 74940
Theoretical pI: Translated: 5.33; Mature: 5.33
Prosite motif: PS50885 HAMP ; PS50883 EAL ; PS50887 GGDEF
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.7 %Cys (Translated Protein) 2.5 %Met (Translated Protein) 3.2 %Cys+Met (Translated Protein) 0.7 %Cys (Mature Protein) 2.5 %Met (Mature Protein) 3.2 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MLGKFLAVQQALRVSLLSLAVSLGFLGMQTVWLASAADRDYLILRDRTASSLQSGLSNAL CCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCEEEEECCCHHHHHHHHHHHH WNFDAETAKAIISDALRANPIRSIHVIDSNGRVFADGQSAQPVVAPSLWESYLGWLVDLK CCCCHHHHHHHHHHHHHCCCCCEEEEECCCCEEEECCCCCCCCCCHHHHHHHHHHHHHCC SEMTLDLRFSSPTDDHYQGMVVGFVFITFDKDHFIRGIADRLADQVLGILVIVLVVALTT CCEEEEEEECCCCCCHHCCEEEEEEEEEECCHHHHHHHHHHHHHHHHHHHHHHHHHHHHH SIVFHLFISRPIIRVARGVADVDPEDPAATVLTVPRAHQRNEIGRMTNRLNHLLGRLAEV HHHHHHHHHCHHHHHHHCCCCCCCCCCCEEEEECCCCHHHHHHHHHHHHHHHHHHHHHHH QGELRLLATRDPLTDLPNRSLILEMMDATINRVALDGGRCAVMFLDLDMFKHVNDSLGHE CCCEEEEEECCCCCCCCCHHHHHHHHHHHHHHEEECCCCEEEEEEEHHHHHHHHHHHCCH AGDLILKDIGRRFDAVVAGLGAVGRLGGDEFVVLIDRYEREDDLARIARRLITTVKRPIE HHHHHHHHHHHHHHHHHHHHHHHHCCCCCCEEEEEECCCCCHHHHHHHHHHHHHHCCCCC VDGTLVHSSTSVGIACYPVDGATPQGLLRNADTAMYAVKASGPGQWAFFDRSMTENALVR CCCEEEECCCCCCEEEEECCCCCHHHHHCCCCCEEEEEEECCCCCEEEEECCCCCCHHEE LRTEASLRSAIEKGQFVLHYQPKLDLRSNRISGCEALIRWDLNGDLVPPGRFISIAEETG EEHHHHHHHHHHCCCEEEEECCCCCCCCCCCCCCEEEEEECCCCCCCCCCCEEEEEHHCC MIYDIGLWVLREACQAQRRWRRHAGAVPIAINVSVRQLKDERFIDDFLDIIQASGADPEL CEEEHHHHHHHHHHHHHHHHHHHCCCCEEEEECHHHHHHHHHHHHHHHHHHHCCCCCCCE LEVEVTESALMSSIEVSAHLLREMRSHGVRLSIDDFGTGYSSLAYLKNLPIDILKIDRSF EEEEEHHHHHHHHHHHHHHHHHHHHHCCCEEEECCCCCCHHHHHHHHCCCCCEEECCHHH VSDLPEESSIPRMIIGLAGQMGLRTVAEGIETEGQLAWLRDNGCDMIQGFLIEKPLPEAD HHCCCCCCCCCHHHHHHCCHHHHHHHHHCCCCCCCEEEEECCCCHHHHHHHHCCCCCHHH FLRFVDAYRTARAFPSAS HHHHHHHHHHHHCCCCCC >Mature Secondary Structure MLGKFLAVQQALRVSLLSLAVSLGFLGMQTVWLASAADRDYLILRDRTASSLQSGLSNAL CCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCEEEEECCCHHHHHHHHHHHH WNFDAETAKAIISDALRANPIRSIHVIDSNGRVFADGQSAQPVVAPSLWESYLGWLVDLK CCCCHHHHHHHHHHHHHCCCCCEEEEECCCCEEEECCCCCCCCCCHHHHHHHHHHHHHCC SEMTLDLRFSSPTDDHYQGMVVGFVFITFDKDHFIRGIADRLADQVLGILVIVLVVALTT CCEEEEEEECCCCCCHHCCEEEEEEEEEECCHHHHHHHHHHHHHHHHHHHHHHHHHHHHH SIVFHLFISRPIIRVARGVADVDPEDPAATVLTVPRAHQRNEIGRMTNRLNHLLGRLAEV HHHHHHHHHCHHHHHHHCCCCCCCCCCCEEEEECCCCHHHHHHHHHHHHHHHHHHHHHHH QGELRLLATRDPLTDLPNRSLILEMMDATINRVALDGGRCAVMFLDLDMFKHVNDSLGHE CCCEEEEEECCCCCCCCCHHHHHHHHHHHHHHEEECCCCEEEEEEEHHHHHHHHHHHCCH AGDLILKDIGRRFDAVVAGLGAVGRLGGDEFVVLIDRYEREDDLARIARRLITTVKRPIE HHHHHHHHHHHHHHHHHHHHHHHHCCCCCCEEEEEECCCCCHHHHHHHHHHHHHHCCCCC VDGTLVHSSTSVGIACYPVDGATPQGLLRNADTAMYAVKASGPGQWAFFDRSMTENALVR CCCEEEECCCCCCEEEEECCCCCHHHHHCCCCCEEEEEEECCCCCEEEEECCCCCCHHEE LRTEASLRSAIEKGQFVLHYQPKLDLRSNRISGCEALIRWDLNGDLVPPGRFISIAEETG EEHHHHHHHHHHCCCEEEEECCCCCCCCCCCCCCEEEEEECCCCCCCCCCCEEEEEHHCC MIYDIGLWVLREACQAQRRWRRHAGAVPIAINVSVRQLKDERFIDDFLDIIQASGADPEL CEEEHHHHHHHHHHHHHHHHHHHCCCCEEEEECHHHHHHHHHHHHHHHHHHHCCCCCCCE LEVEVTESALMSSIEVSAHLLREMRSHGVRLSIDDFGTGYSSLAYLKNLPIDILKIDRSF EEEEEHHHHHHHHHHHHHHHHHHHHHCCCEEEECCCCCCHHHHHHHHCCCCCEEECCHHH VSDLPEESSIPRMIIGLAGQMGLRTVAEGIETEGQLAWLRDNGCDMIQGFLIEKPLPEAD HHCCCCCCCCCHHHHHHCCHHHHHHHHHCCCCCCCEEEEECCCCHHHHHHHHCCCCCHHH FLRFVDAYRTARAFPSAS HHHHHHHHHHHHCCCCCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 6.0
TargetDB status: NA
Availability: NA
References: 9384377; 11728710 [H]