| Definition | Xanthobacter autotrophicus Py2 chromosome, complete genome. |
|---|---|
| Accession | NC_009720 |
| Length | 5,308,934 |
Click here to switch to the map view.
The map label for this gene is rcsC [H]
Identifier: 154244942
GI number: 154244942
Start: 1109547
End: 1111535
Strand: Reverse
Name: rcsC [H]
Synonym: Xaut_0992
Alternate gene names: 154244942
Gene position: 1111535-1109547 (Counterclockwise)
Preceding gene: 154244944
Following gene: 154244940
Centisome position: 20.94
GC content: 67.37
Gene sequence:
>1989_bases ATGCCTTTGTTCCAAGAACAGGGTTCACACCGAACCGCCGCGATTATTCGTCGATGGCCCGCAGAGCCGACCCTTTACTT CACAGACGTGTGCTATAAGCGGCGACGTCTCAGCAGATCCGAGGCGACGGTGACGCTCCAGAGGTCGATATTATCCCTGC CCCCCGGCGCGACACCGCTCCCGAGCGGGAAGCCGGACCTGCGCGAGCGCGCCCTCGAGCCCGCCGCCGCGCACGACCGC GTCCAGTCCGAGCAGCTCAAGGTCCTGTTCCGGAACACACCCGTCGGCGTGCTCGGCGCCATGATCGGCGGCCTCATCCT CGCGTATGTGCTGTTACTGCACGACGGCGTCTCCTTCGACACCGTGGCCACATGGTCTGCCATACTTGTCGCCGTCGCCC TCAGCCACCTTGTCCTGTGCTGGATCTACTGGCGCGTGGCGCTGCCCGCGCGCCTGCCCATGCTGGCCCTGATCTTCACC GCGATCAGCCTCATGGAAGGCATCACCTGGGGCACCGGATCGGTGCTGCTGGTCTCGCCCAGCCGCATCGAGCTTCAGCT CTGGGTGATGATCGTCACCTCGGCGGTGGCATCGGGCGCCGCCTCGGCGTTCGGCAGCTACCTGCCGGCCTTCTACGCGC TGCTGTTTCCCGCCATGCTGCCTTATCCGGTCTGGGCGGTGCTGCATGGGGGCATCCTCTCCCATGCCCTGATGGTGCTG GATCTGCTCTATGTGGTCGCCATGGCCGCGCTGGGCTGGCGCTCCAACCGGGGCCTGGTGGAGGCCCTGCGCCTCAGGTT CGAGAACATCGACCTGTTGGTGGAGGTCCGGAACGAGAAGGAACGCGCCGAGCAGGCCAGCCGCGACAAGTCGCGCTTTC TCGCGGCAGCAAGCCACGACCTGCGCCAGCCCGTCCACGCGCTCACCATGTTCCTGGGCGCCATGCAGAATTGCAACCTG GACGCGCCGGCCCGCCAGATCCTGGGGCACATCGATGAATCCGTCTCCGCCCTCGACGGCCTCTTCACCTCGCTGCTCGA CATCTCGCGCCTCGACGCCGGCGTGGTGCAATCGGATTCCCGCGCCTTCCACATCCAACCGCTGGTGGAGCGGATCGTGC GCGACTACGACGAGGAAGCCGCGCGCAAGGGGATCGCCCTCGTGGTCCAGCCCTGCTCACTGGCGGTGATGGCCGACCCG ATCCTGCTGGAGCGCGTGCTGCGCAATCTGGTCTCCAACGCGGTGCGCTACACCGAGAGGGGACGCGTGCTCATCGGCTG CCGCAGGGGCAGGCGCCTGTCCATCGAGGTCTGGGACACCGGCAAGGGCATCCCGGGCGAGGAACAGCAGCGGATTTTCC AGGAATACTACCAGCTCGGCAATGCGGAGCGGGACCGGGCCATGGGCCTCGGGCTGGGGCTTGCCATCGTGAAGCGGCTC GCCGAACTCATGGCCTGCCCGCTGGCGCTGCGCTCGCAGCCGGGCAAGGGCTCGGTGTTCGCCATTTCGGTGCCTCTCGC CACCAGCGCGCCCGAACAGCCCGCCGCCAGCGCCGGGCCCGCCCGCGGAGCCATGGTTTCGGGCCTGATCCTCGTGGTGG ACGACGAGGCTCCCATCCAGTCCGCCATGCAGAGCCTGCTCGCGAGCTGGGGACACGAGGTGATCGTCGCCGAATCCCTG GCGCAGATGCTGGACAAGGTCGCCACCTGCCCGCGCCAGCCGGACCTCATCATCTGCGATTATCGGCTGCGCCAGGGCGA GAACGGCATCGCGACCATCCAGCGGCTGCAGTCCGAATACAACGAGGACATTCCAGCCCTGTTGATCACCGGCGACACCG CGCCGGACCGGCTCAAGGAAGCCCGCGAAAGCGGCTTCCTGCTGCTCCACAAACCGCTCCACAACAGCAAGCTCCGGGCC GCCATCACCAACCTGCTGGCCCAGGGCGCGCGCACCCCACCCGTGGAGGAGGAGACCCGGCTCAGATAA
Upstream 100 bases:
>100_bases ACCGATCGTCCTACGACCTGTCCTATGACGTTTCACATGGCCAGAATCGGTCCATGCTTATGTGAAGTCGTATCTTATTA TAATACCTATATTTTCTCGG
Downstream 100 bases:
>100_bases GGTTGCCCTGGCGGGCAGCGCTCGCCGCCTGGGTGCGGTTGATCACATGCAGTGACCTGAAGATGCTGGTGATGTGCACC TTCACCGTCTTCTCGGACAG
Product: integral membrane sensor hybrid histidine kinase
Products: NA
Alternate protein names: Capsular synthesis regulator component C [H]
Number of amino acids: Translated: 662; Mature: 661
Protein sequence:
>662_residues MPLFQEQGSHRTAAIIRRWPAEPTLYFTDVCYKRRRLSRSEATVTLQRSILSLPPGATPLPSGKPDLRERALEPAAAHDR VQSEQLKVLFRNTPVGVLGAMIGGLILAYVLLLHDGVSFDTVATWSAILVAVALSHLVLCWIYWRVALPARLPMLALIFT AISLMEGITWGTGSVLLVSPSRIELQLWVMIVTSAVASGAASAFGSYLPAFYALLFPAMLPYPVWAVLHGGILSHALMVL DLLYVVAMAALGWRSNRGLVEALRLRFENIDLLVEVRNEKERAEQASRDKSRFLAAASHDLRQPVHALTMFLGAMQNCNL DAPARQILGHIDESVSALDGLFTSLLDISRLDAGVVQSDSRAFHIQPLVERIVRDYDEEAARKGIALVVQPCSLAVMADP ILLERVLRNLVSNAVRYTERGRVLIGCRRGRRLSIEVWDTGKGIPGEEQQRIFQEYYQLGNAERDRAMGLGLGLAIVKRL AELMACPLALRSQPGKGSVFAISVPLATSAPEQPAASAGPARGAMVSGLILVVDDEAPIQSAMQSLLASWGHEVIVAESL AQMLDKVATCPRQPDLIICDYRLRQGENGIATIQRLQSEYNEDIPALLITGDTAPDRLKEARESGFLLLHKPLHNSKLRA AITNLLAQGARTPPVEEETRLR
Sequences:
>Translated_662_residues MPLFQEQGSHRTAAIIRRWPAEPTLYFTDVCYKRRRLSRSEATVTLQRSILSLPPGATPLPSGKPDLRERALEPAAAHDR VQSEQLKVLFRNTPVGVLGAMIGGLILAYVLLLHDGVSFDTVATWSAILVAVALSHLVLCWIYWRVALPARLPMLALIFT AISLMEGITWGTGSVLLVSPSRIELQLWVMIVTSAVASGAASAFGSYLPAFYALLFPAMLPYPVWAVLHGGILSHALMVL DLLYVVAMAALGWRSNRGLVEALRLRFENIDLLVEVRNEKERAEQASRDKSRFLAAASHDLRQPVHALTMFLGAMQNCNL DAPARQILGHIDESVSALDGLFTSLLDISRLDAGVVQSDSRAFHIQPLVERIVRDYDEEAARKGIALVVQPCSLAVMADP ILLERVLRNLVSNAVRYTERGRVLIGCRRGRRLSIEVWDTGKGIPGEEQQRIFQEYYQLGNAERDRAMGLGLGLAIVKRL AELMACPLALRSQPGKGSVFAISVPLATSAPEQPAASAGPARGAMVSGLILVVDDEAPIQSAMQSLLASWGHEVIVAESL AQMLDKVATCPRQPDLIICDYRLRQGENGIATIQRLQSEYNEDIPALLITGDTAPDRLKEARESGFLLLHKPLHNSKLRA AITNLLAQGARTPPVEEETRLR >Mature_661_residues PLFQEQGSHRTAAIIRRWPAEPTLYFTDVCYKRRRLSRSEATVTLQRSILSLPPGATPLPSGKPDLRERALEPAAAHDRV QSEQLKVLFRNTPVGVLGAMIGGLILAYVLLLHDGVSFDTVATWSAILVAVALSHLVLCWIYWRVALPARLPMLALIFTA ISLMEGITWGTGSVLLVSPSRIELQLWVMIVTSAVASGAASAFGSYLPAFYALLFPAMLPYPVWAVLHGGILSHALMVLD LLYVVAMAALGWRSNRGLVEALRLRFENIDLLVEVRNEKERAEQASRDKSRFLAAASHDLRQPVHALTMFLGAMQNCNLD APARQILGHIDESVSALDGLFTSLLDISRLDAGVVQSDSRAFHIQPLVERIVRDYDEEAARKGIALVVQPCSLAVMADPI LLERVLRNLVSNAVRYTERGRVLIGCRRGRRLSIEVWDTGKGIPGEEQQRIFQEYYQLGNAERDRAMGLGLGLAIVKRLA ELMACPLALRSQPGKGSVFAISVPLATSAPEQPAASAGPARGAMVSGLILVVDDEAPIQSAMQSLLASWGHEVIVAESLA QMLDKVATCPRQPDLIICDYRLRQGENGIATIQRLQSEYNEDIPALLITGDTAPDRLKEARESGFLLLHKPLHNSKLRAA ITNLLAQGARTPPVEEETRLR
Specific function: Member of the two-component regulatory system RcsC/RcsB involved in the regulation of the expression of genes involved in colanic acid capsule synthesis. Together with RcsF, RcsC probably functions as a membrane-associated protein kinase that phosphorylat
COG id: COG0642
COG function: function code T; Signal transduction histidine kinase
Gene ontology:
Cell location: Cell inner membrane; Multi-pass membrane protein [H]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 1 response regulatory domain [H]
Homologues:
Organism=Escherichia coli, GI145693157, Length=241, Percent_Identity=33.195020746888, Blast_Score=138, Evalue=9e-34, Organism=Escherichia coli, GI48994928, Length=381, Percent_Identity=28.6089238845144, Blast_Score=134, Evalue=2e-32, Organism=Escherichia coli, GI1788713, Length=392, Percent_Identity=29.5918367346939, Blast_Score=133, Evalue=4e-32, Organism=Escherichia coli, GI1789149, Length=242, Percent_Identity=33.0578512396694, Blast_Score=126, Evalue=4e-30, Organism=Escherichia coli, GI87081816, Length=358, Percent_Identity=30.4469273743017, Blast_Score=114, Evalue=2e-26, Organism=Escherichia coli, GI87082128, Length=234, Percent_Identity=31.1965811965812, Blast_Score=87, Evalue=4e-18, Organism=Escherichia coli, GI1786912, Length=244, Percent_Identity=30.7377049180328, Blast_Score=85, Evalue=2e-17, Organism=Escherichia coli, GI1786600, Length=222, Percent_Identity=28.3783783783784, Blast_Score=82, Evalue=1e-16, Organism=Escherichia coli, GI1786783, Length=228, Percent_Identity=25.4385964912281, Blast_Score=76, Evalue=5e-15, Organism=Escherichia coli, GI1788393, Length=233, Percent_Identity=27.0386266094421, Blast_Score=74, Evalue=3e-14, Organism=Escherichia coli, GI1788279, Length=223, Percent_Identity=29.1479820627803, Blast_Score=74, Evalue=3e-14, Organism=Escherichia coli, GI1790861, Length=209, Percent_Identity=29.1866028708134, Blast_Score=72, Evalue=8e-14, Organism=Escherichia coli, GI1787894, Length=228, Percent_Identity=28.5087719298246, Blast_Score=65, Evalue=1e-11, Organism=Escherichia coli, GI1790346, Length=192, Percent_Identity=27.6041666666667, Blast_Score=64, Evalue=5e-11,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR003594 - InterPro: IPR011006 - InterPro: IPR000014 - InterPro: IPR004358 - InterPro: IPR019017 - InterPro: IPR003661 - InterPro: IPR005467 - InterPro: IPR009082 - InterPro: IPR001789 [H]
Pfam domain/function: PF02518 HATPase_c; PF00512 HisKA; PF09456 RcsC; PF00072 Response_reg [H]
EC number: =2.7.13.3 [H]
Molecular weight: Translated: 72557; Mature: 72426
Theoretical pI: Translated: 8.03; Mature: 8.03
Prosite motif: PS50110 RESPONSE_REGULATORY ; PS50109 HIS_KIN
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.2 %Cys (Translated Protein) 2.4 %Met (Translated Protein) 3.6 %Cys+Met (Translated Protein) 1.2 %Cys (Mature Protein) 2.3 %Met (Mature Protein) 3.5 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MPLFQEQGSHRTAAIIRRWPAEPTLYFTDVCYKRRRLSRSEATVTLQRSILSLPPGATPL CCCCCCCCCCHHHHHHHHCCCCCCEEHHHHHHHHHHCCHHHHHHHHHHHHHCCCCCCCCC PSGKPDLRERALEPAAAHDRVQSEQLKVLFRNTPVGVLGAMIGGLILAYVLLLHDGVSFD CCCCCHHHHHHCCCHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHCCCCCH TVATWSAILVAVALSHLVLCWIYWRVALPARLPMLALIFTAISLMEGITWGTGSVLLVSP HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCEEEECC SRIELQLWVMIVTSAVASGAASAFGSYLPAFYALLFPAMLPYPVWAVLHGGILSHALMVL CCEEHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHH DLLYVVAMAALGWRSNRGLVEALRLRFENIDLLVEVRNEKERAEQASRDKSRFLAAASHD HHHHHHHHHHHCCCCCCCHHHHHHHHHCCCEEEEEECCHHHHHHHHHHHHHHHHHHHHHH LRQPVHALTMFLGAMQNCNLDAPARQILGHIDESVSALDGLFTSLLDISRLDAGVVQSDS HHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCC RAFHIQPLVERIVRDYDEEAARKGIALVVQPCSLAVMADPILLERVLRNLVSNAVRYTER CEEEHHHHHHHHHHHHHHHHHHCCCEEEEECCHHHHHHCHHHHHHHHHHHHHHHHHHHHC GRVLIGCRRGRRLSIEVWDTGKGIPGEEQQRIFQEYYQLGNAERDRAMGLGLGLAIVKRL CCEEEEECCCCEEEEEEEECCCCCCCHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHH AELMACPLALRSQPGKGSVFAISVPLATSAPEQPAASAGPARGAMVSGLILVVDDEAPIQ HHHHHCCHHHCCCCCCCCEEEEEECCCCCCCCCCCCCCCCCCCHHHCCEEEEECCCCHHH SAMQSLLASWGHEVIVAESLAQMLDKVATCPRQPDLIICDYRLRQGENGIATIQRLQSEY HHHHHHHHHCCCHHHHHHHHHHHHHHHHCCCCCCCEEEECCHHHCCCCHHHHHHHHHHHH NEDIPALLITGDTAPDRLKEARESGFLLLHKPLHNSKLRAAITNLLAQGARTPPVEEETR CCCCCEEEEECCCCHHHHHHHHHCCEEEEECCCCCHHHHHHHHHHHHCCCCCCCCCHHCC LR CC >Mature Secondary Structure PLFQEQGSHRTAAIIRRWPAEPTLYFTDVCYKRRRLSRSEATVTLQRSILSLPPGATPL CCCCCCCCCHHHHHHHHCCCCCCEEHHHHHHHHHHCCHHHHHHHHHHHHHCCCCCCCCC PSGKPDLRERALEPAAAHDRVQSEQLKVLFRNTPVGVLGAMIGGLILAYVLLLHDGVSFD CCCCCHHHHHHCCCHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHCCCCCH TVATWSAILVAVALSHLVLCWIYWRVALPARLPMLALIFTAISLMEGITWGTGSVLLVSP HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCEEEECC SRIELQLWVMIVTSAVASGAASAFGSYLPAFYALLFPAMLPYPVWAVLHGGILSHALMVL CCEEHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHH DLLYVVAMAALGWRSNRGLVEALRLRFENIDLLVEVRNEKERAEQASRDKSRFLAAASHD HHHHHHHHHHHCCCCCCCHHHHHHHHHCCCEEEEEECCHHHHHHHHHHHHHHHHHHHHHH LRQPVHALTMFLGAMQNCNLDAPARQILGHIDESVSALDGLFTSLLDISRLDAGVVQSDS HHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCC RAFHIQPLVERIVRDYDEEAARKGIALVVQPCSLAVMADPILLERVLRNLVSNAVRYTER CEEEHHHHHHHHHHHHHHHHHHCCCEEEEECCHHHHHHCHHHHHHHHHHHHHHHHHHHHC GRVLIGCRRGRRLSIEVWDTGKGIPGEEQQRIFQEYYQLGNAERDRAMGLGLGLAIVKRL CCEEEEECCCCEEEEEEEECCCCCCCHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHH AELMACPLALRSQPGKGSVFAISVPLATSAPEQPAASAGPARGAMVSGLILVVDDEAPIQ HHHHHCCHHHCCCCCCCCEEEEEECCCCCCCCCCCCCCCCCCCHHHCCEEEEECCCCHHH SAMQSLLASWGHEVIVAESLAQMLDKVATCPRQPDLIICDYRLRQGENGIATIQRLQSEY HHHHHHHHHCCCHHHHHHHHHHHHHHHHCCCCCCCEEEECCHHHCCCCHHHHHHHHHHHH NEDIPALLITGDTAPDRLKEARESGFLLLHKPLHNSKLRAAITNLLAQGARTPPVEEETR CCCCCEEEEECCCCHHHHHHHHHCCEEEEECCCCCHHHHHHHHHHHHCCCCCCCCCHHCC LR CC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 6.0
TargetDB status: NA
Availability: NA
References: 2404948; 8366025; 9097040; 9278503; 11758943; 11309126; 13129944 [H]