Definition Xanthobacter autotrophicus Py2 chromosome, complete genome.
Accession NC_009720
Length 5,308,934

Click here to switch to the map view.

The map label for this gene is rcsC [H]

Identifier: 154244942

GI number: 154244942

Start: 1109547

End: 1111535

Strand: Reverse

Name: rcsC [H]

Synonym: Xaut_0992

Alternate gene names: 154244942

Gene position: 1111535-1109547 (Counterclockwise)

Preceding gene: 154244944

Following gene: 154244940

Centisome position: 20.94

GC content: 67.37

Gene sequence:

>1989_bases
ATGCCTTTGTTCCAAGAACAGGGTTCACACCGAACCGCCGCGATTATTCGTCGATGGCCCGCAGAGCCGACCCTTTACTT
CACAGACGTGTGCTATAAGCGGCGACGTCTCAGCAGATCCGAGGCGACGGTGACGCTCCAGAGGTCGATATTATCCCTGC
CCCCCGGCGCGACACCGCTCCCGAGCGGGAAGCCGGACCTGCGCGAGCGCGCCCTCGAGCCCGCCGCCGCGCACGACCGC
GTCCAGTCCGAGCAGCTCAAGGTCCTGTTCCGGAACACACCCGTCGGCGTGCTCGGCGCCATGATCGGCGGCCTCATCCT
CGCGTATGTGCTGTTACTGCACGACGGCGTCTCCTTCGACACCGTGGCCACATGGTCTGCCATACTTGTCGCCGTCGCCC
TCAGCCACCTTGTCCTGTGCTGGATCTACTGGCGCGTGGCGCTGCCCGCGCGCCTGCCCATGCTGGCCCTGATCTTCACC
GCGATCAGCCTCATGGAAGGCATCACCTGGGGCACCGGATCGGTGCTGCTGGTCTCGCCCAGCCGCATCGAGCTTCAGCT
CTGGGTGATGATCGTCACCTCGGCGGTGGCATCGGGCGCCGCCTCGGCGTTCGGCAGCTACCTGCCGGCCTTCTACGCGC
TGCTGTTTCCCGCCATGCTGCCTTATCCGGTCTGGGCGGTGCTGCATGGGGGCATCCTCTCCCATGCCCTGATGGTGCTG
GATCTGCTCTATGTGGTCGCCATGGCCGCGCTGGGCTGGCGCTCCAACCGGGGCCTGGTGGAGGCCCTGCGCCTCAGGTT
CGAGAACATCGACCTGTTGGTGGAGGTCCGGAACGAGAAGGAACGCGCCGAGCAGGCCAGCCGCGACAAGTCGCGCTTTC
TCGCGGCAGCAAGCCACGACCTGCGCCAGCCCGTCCACGCGCTCACCATGTTCCTGGGCGCCATGCAGAATTGCAACCTG
GACGCGCCGGCCCGCCAGATCCTGGGGCACATCGATGAATCCGTCTCCGCCCTCGACGGCCTCTTCACCTCGCTGCTCGA
CATCTCGCGCCTCGACGCCGGCGTGGTGCAATCGGATTCCCGCGCCTTCCACATCCAACCGCTGGTGGAGCGGATCGTGC
GCGACTACGACGAGGAAGCCGCGCGCAAGGGGATCGCCCTCGTGGTCCAGCCCTGCTCACTGGCGGTGATGGCCGACCCG
ATCCTGCTGGAGCGCGTGCTGCGCAATCTGGTCTCCAACGCGGTGCGCTACACCGAGAGGGGACGCGTGCTCATCGGCTG
CCGCAGGGGCAGGCGCCTGTCCATCGAGGTCTGGGACACCGGCAAGGGCATCCCGGGCGAGGAACAGCAGCGGATTTTCC
AGGAATACTACCAGCTCGGCAATGCGGAGCGGGACCGGGCCATGGGCCTCGGGCTGGGGCTTGCCATCGTGAAGCGGCTC
GCCGAACTCATGGCCTGCCCGCTGGCGCTGCGCTCGCAGCCGGGCAAGGGCTCGGTGTTCGCCATTTCGGTGCCTCTCGC
CACCAGCGCGCCCGAACAGCCCGCCGCCAGCGCCGGGCCCGCCCGCGGAGCCATGGTTTCGGGCCTGATCCTCGTGGTGG
ACGACGAGGCTCCCATCCAGTCCGCCATGCAGAGCCTGCTCGCGAGCTGGGGACACGAGGTGATCGTCGCCGAATCCCTG
GCGCAGATGCTGGACAAGGTCGCCACCTGCCCGCGCCAGCCGGACCTCATCATCTGCGATTATCGGCTGCGCCAGGGCGA
GAACGGCATCGCGACCATCCAGCGGCTGCAGTCCGAATACAACGAGGACATTCCAGCCCTGTTGATCACCGGCGACACCG
CGCCGGACCGGCTCAAGGAAGCCCGCGAAAGCGGCTTCCTGCTGCTCCACAAACCGCTCCACAACAGCAAGCTCCGGGCC
GCCATCACCAACCTGCTGGCCCAGGGCGCGCGCACCCCACCCGTGGAGGAGGAGACCCGGCTCAGATAA

Upstream 100 bases:

>100_bases
ACCGATCGTCCTACGACCTGTCCTATGACGTTTCACATGGCCAGAATCGGTCCATGCTTATGTGAAGTCGTATCTTATTA
TAATACCTATATTTTCTCGG

Downstream 100 bases:

>100_bases
GGTTGCCCTGGCGGGCAGCGCTCGCCGCCTGGGTGCGGTTGATCACATGCAGTGACCTGAAGATGCTGGTGATGTGCACC
TTCACCGTCTTCTCGGACAG

Product: integral membrane sensor hybrid histidine kinase

Products: NA

Alternate protein names: Capsular synthesis regulator component C [H]

Number of amino acids: Translated: 662; Mature: 661

Protein sequence:

>662_residues
MPLFQEQGSHRTAAIIRRWPAEPTLYFTDVCYKRRRLSRSEATVTLQRSILSLPPGATPLPSGKPDLRERALEPAAAHDR
VQSEQLKVLFRNTPVGVLGAMIGGLILAYVLLLHDGVSFDTVATWSAILVAVALSHLVLCWIYWRVALPARLPMLALIFT
AISLMEGITWGTGSVLLVSPSRIELQLWVMIVTSAVASGAASAFGSYLPAFYALLFPAMLPYPVWAVLHGGILSHALMVL
DLLYVVAMAALGWRSNRGLVEALRLRFENIDLLVEVRNEKERAEQASRDKSRFLAAASHDLRQPVHALTMFLGAMQNCNL
DAPARQILGHIDESVSALDGLFTSLLDISRLDAGVVQSDSRAFHIQPLVERIVRDYDEEAARKGIALVVQPCSLAVMADP
ILLERVLRNLVSNAVRYTERGRVLIGCRRGRRLSIEVWDTGKGIPGEEQQRIFQEYYQLGNAERDRAMGLGLGLAIVKRL
AELMACPLALRSQPGKGSVFAISVPLATSAPEQPAASAGPARGAMVSGLILVVDDEAPIQSAMQSLLASWGHEVIVAESL
AQMLDKVATCPRQPDLIICDYRLRQGENGIATIQRLQSEYNEDIPALLITGDTAPDRLKEARESGFLLLHKPLHNSKLRA
AITNLLAQGARTPPVEEETRLR

Sequences:

>Translated_662_residues
MPLFQEQGSHRTAAIIRRWPAEPTLYFTDVCYKRRRLSRSEATVTLQRSILSLPPGATPLPSGKPDLRERALEPAAAHDR
VQSEQLKVLFRNTPVGVLGAMIGGLILAYVLLLHDGVSFDTVATWSAILVAVALSHLVLCWIYWRVALPARLPMLALIFT
AISLMEGITWGTGSVLLVSPSRIELQLWVMIVTSAVASGAASAFGSYLPAFYALLFPAMLPYPVWAVLHGGILSHALMVL
DLLYVVAMAALGWRSNRGLVEALRLRFENIDLLVEVRNEKERAEQASRDKSRFLAAASHDLRQPVHALTMFLGAMQNCNL
DAPARQILGHIDESVSALDGLFTSLLDISRLDAGVVQSDSRAFHIQPLVERIVRDYDEEAARKGIALVVQPCSLAVMADP
ILLERVLRNLVSNAVRYTERGRVLIGCRRGRRLSIEVWDTGKGIPGEEQQRIFQEYYQLGNAERDRAMGLGLGLAIVKRL
AELMACPLALRSQPGKGSVFAISVPLATSAPEQPAASAGPARGAMVSGLILVVDDEAPIQSAMQSLLASWGHEVIVAESL
AQMLDKVATCPRQPDLIICDYRLRQGENGIATIQRLQSEYNEDIPALLITGDTAPDRLKEARESGFLLLHKPLHNSKLRA
AITNLLAQGARTPPVEEETRLR
>Mature_661_residues
PLFQEQGSHRTAAIIRRWPAEPTLYFTDVCYKRRRLSRSEATVTLQRSILSLPPGATPLPSGKPDLRERALEPAAAHDRV
QSEQLKVLFRNTPVGVLGAMIGGLILAYVLLLHDGVSFDTVATWSAILVAVALSHLVLCWIYWRVALPARLPMLALIFTA
ISLMEGITWGTGSVLLVSPSRIELQLWVMIVTSAVASGAASAFGSYLPAFYALLFPAMLPYPVWAVLHGGILSHALMVLD
LLYVVAMAALGWRSNRGLVEALRLRFENIDLLVEVRNEKERAEQASRDKSRFLAAASHDLRQPVHALTMFLGAMQNCNLD
APARQILGHIDESVSALDGLFTSLLDISRLDAGVVQSDSRAFHIQPLVERIVRDYDEEAARKGIALVVQPCSLAVMADPI
LLERVLRNLVSNAVRYTERGRVLIGCRRGRRLSIEVWDTGKGIPGEEQQRIFQEYYQLGNAERDRAMGLGLGLAIVKRLA
ELMACPLALRSQPGKGSVFAISVPLATSAPEQPAASAGPARGAMVSGLILVVDDEAPIQSAMQSLLASWGHEVIVAESLA
QMLDKVATCPRQPDLIICDYRLRQGENGIATIQRLQSEYNEDIPALLITGDTAPDRLKEARESGFLLLHKPLHNSKLRAA
ITNLLAQGARTPPVEEETRLR

Specific function: Member of the two-component regulatory system RcsC/RcsB involved in the regulation of the expression of genes involved in colanic acid capsule synthesis. Together with RcsF, RcsC probably functions as a membrane-associated protein kinase that phosphorylat

COG id: COG0642

COG function: function code T; Signal transduction histidine kinase

Gene ontology:

Cell location: Cell inner membrane; Multi-pass membrane protein [H]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 response regulatory domain [H]

Homologues:

Organism=Escherichia coli, GI145693157, Length=241, Percent_Identity=33.195020746888, Blast_Score=138, Evalue=9e-34,
Organism=Escherichia coli, GI48994928, Length=381, Percent_Identity=28.6089238845144, Blast_Score=134, Evalue=2e-32,
Organism=Escherichia coli, GI1788713, Length=392, Percent_Identity=29.5918367346939, Blast_Score=133, Evalue=4e-32,
Organism=Escherichia coli, GI1789149, Length=242, Percent_Identity=33.0578512396694, Blast_Score=126, Evalue=4e-30,
Organism=Escherichia coli, GI87081816, Length=358, Percent_Identity=30.4469273743017, Blast_Score=114, Evalue=2e-26,
Organism=Escherichia coli, GI87082128, Length=234, Percent_Identity=31.1965811965812, Blast_Score=87, Evalue=4e-18,
Organism=Escherichia coli, GI1786912, Length=244, Percent_Identity=30.7377049180328, Blast_Score=85, Evalue=2e-17,
Organism=Escherichia coli, GI1786600, Length=222, Percent_Identity=28.3783783783784, Blast_Score=82, Evalue=1e-16,
Organism=Escherichia coli, GI1786783, Length=228, Percent_Identity=25.4385964912281, Blast_Score=76, Evalue=5e-15,
Organism=Escherichia coli, GI1788393, Length=233, Percent_Identity=27.0386266094421, Blast_Score=74, Evalue=3e-14,
Organism=Escherichia coli, GI1788279, Length=223, Percent_Identity=29.1479820627803, Blast_Score=74, Evalue=3e-14,
Organism=Escherichia coli, GI1790861, Length=209, Percent_Identity=29.1866028708134, Blast_Score=72, Evalue=8e-14,
Organism=Escherichia coli, GI1787894, Length=228, Percent_Identity=28.5087719298246, Blast_Score=65, Evalue=1e-11,
Organism=Escherichia coli, GI1790346, Length=192, Percent_Identity=27.6041666666667, Blast_Score=64, Evalue=5e-11,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR003594
- InterPro:   IPR011006
- InterPro:   IPR000014
- InterPro:   IPR004358
- InterPro:   IPR019017
- InterPro:   IPR003661
- InterPro:   IPR005467
- InterPro:   IPR009082
- InterPro:   IPR001789 [H]

Pfam domain/function: PF02518 HATPase_c; PF00512 HisKA; PF09456 RcsC; PF00072 Response_reg [H]

EC number: =2.7.13.3 [H]

Molecular weight: Translated: 72557; Mature: 72426

Theoretical pI: Translated: 8.03; Mature: 8.03

Prosite motif: PS50110 RESPONSE_REGULATORY ; PS50109 HIS_KIN

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.2 %Cys     (Translated Protein)
2.4 %Met     (Translated Protein)
3.6 %Cys+Met (Translated Protein)
1.2 %Cys     (Mature Protein)
2.3 %Met     (Mature Protein)
3.5 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MPLFQEQGSHRTAAIIRRWPAEPTLYFTDVCYKRRRLSRSEATVTLQRSILSLPPGATPL
CCCCCCCCCCHHHHHHHHCCCCCCEEHHHHHHHHHHCCHHHHHHHHHHHHHCCCCCCCCC
PSGKPDLRERALEPAAAHDRVQSEQLKVLFRNTPVGVLGAMIGGLILAYVLLLHDGVSFD
CCCCCHHHHHHCCCHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHCCCCCH
TVATWSAILVAVALSHLVLCWIYWRVALPARLPMLALIFTAISLMEGITWGTGSVLLVSP
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCEEEECC
SRIELQLWVMIVTSAVASGAASAFGSYLPAFYALLFPAMLPYPVWAVLHGGILSHALMVL
CCEEHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHH
DLLYVVAMAALGWRSNRGLVEALRLRFENIDLLVEVRNEKERAEQASRDKSRFLAAASHD
HHHHHHHHHHHCCCCCCCHHHHHHHHHCCCEEEEEECCHHHHHHHHHHHHHHHHHHHHHH
LRQPVHALTMFLGAMQNCNLDAPARQILGHIDESVSALDGLFTSLLDISRLDAGVVQSDS
HHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCC
RAFHIQPLVERIVRDYDEEAARKGIALVVQPCSLAVMADPILLERVLRNLVSNAVRYTER
CEEEHHHHHHHHHHHHHHHHHHCCCEEEEECCHHHHHHCHHHHHHHHHHHHHHHHHHHHC
GRVLIGCRRGRRLSIEVWDTGKGIPGEEQQRIFQEYYQLGNAERDRAMGLGLGLAIVKRL
CCEEEEECCCCEEEEEEEECCCCCCCHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHH
AELMACPLALRSQPGKGSVFAISVPLATSAPEQPAASAGPARGAMVSGLILVVDDEAPIQ
HHHHHCCHHHCCCCCCCCEEEEEECCCCCCCCCCCCCCCCCCCHHHCCEEEEECCCCHHH
SAMQSLLASWGHEVIVAESLAQMLDKVATCPRQPDLIICDYRLRQGENGIATIQRLQSEY
HHHHHHHHHCCCHHHHHHHHHHHHHHHHCCCCCCCEEEECCHHHCCCCHHHHHHHHHHHH
NEDIPALLITGDTAPDRLKEARESGFLLLHKPLHNSKLRAAITNLLAQGARTPPVEEETR
CCCCCEEEEECCCCHHHHHHHHHCCEEEEECCCCCHHHHHHHHHHHHCCCCCCCCCHHCC
LR
CC
>Mature Secondary Structure 
PLFQEQGSHRTAAIIRRWPAEPTLYFTDVCYKRRRLSRSEATVTLQRSILSLPPGATPL
CCCCCCCCCHHHHHHHHCCCCCCEEHHHHHHHHHHCCHHHHHHHHHHHHHCCCCCCCCC
PSGKPDLRERALEPAAAHDRVQSEQLKVLFRNTPVGVLGAMIGGLILAYVLLLHDGVSFD
CCCCCHHHHHHCCCHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHCCCCCH
TVATWSAILVAVALSHLVLCWIYWRVALPARLPMLALIFTAISLMEGITWGTGSVLLVSP
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCEEEECC
SRIELQLWVMIVTSAVASGAASAFGSYLPAFYALLFPAMLPYPVWAVLHGGILSHALMVL
CCEEHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHH
DLLYVVAMAALGWRSNRGLVEALRLRFENIDLLVEVRNEKERAEQASRDKSRFLAAASHD
HHHHHHHHHHHCCCCCCCHHHHHHHHHCCCEEEEEECCHHHHHHHHHHHHHHHHHHHHHH
LRQPVHALTMFLGAMQNCNLDAPARQILGHIDESVSALDGLFTSLLDISRLDAGVVQSDS
HHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCC
RAFHIQPLVERIVRDYDEEAARKGIALVVQPCSLAVMADPILLERVLRNLVSNAVRYTER
CEEEHHHHHHHHHHHHHHHHHHCCCEEEEECCHHHHHHCHHHHHHHHHHHHHHHHHHHHC
GRVLIGCRRGRRLSIEVWDTGKGIPGEEQQRIFQEYYQLGNAERDRAMGLGLGLAIVKRL
CCEEEEECCCCEEEEEEEECCCCCCCHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHH
AELMACPLALRSQPGKGSVFAISVPLATSAPEQPAASAGPARGAMVSGLILVVDDEAPIQ
HHHHHCCHHHCCCCCCCCEEEEEECCCCCCCCCCCCCCCCCCCHHHCCEEEEECCCCHHH
SAMQSLLASWGHEVIVAESLAQMLDKVATCPRQPDLIICDYRLRQGENGIATIQRLQSEY
HHHHHHHHHCCCHHHHHHHHHHHHHHHHCCCCCCCEEEECCHHHCCCCHHHHHHHHHHHH
NEDIPALLITGDTAPDRLKEARESGFLLLHKPLHNSKLRAAITNLLAQGARTPPVEEETR
CCCCCEEEEECCCCHHHHHHHHHCCEEEEECCCCCHHHHHHHHHHHHCCCCCCCCCHHCC
LR
CC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 2404948; 8366025; 9097040; 9278503; 11758943; 11309126; 13129944 [H]