Definition Parabacteroides distasonis ATCC 8503 chromosome, complete genome.
Accession NC_009615
Length 4,811,379

Click here to switch to the map view.

The map label for this gene is rcsC [H]

Identifier: 150008033

GI number: 150008033

Start: 1621008

End: 1622876

Strand: Reverse

Name: rcsC [H]

Synonym: BDI_1396

Alternate gene names: 150008033

Gene position: 1622876-1621008 (Counterclockwise)

Preceding gene: 150008035

Following gene: 150008021

Centisome position: 33.73

GC content: 42.7

Gene sequence:

>1869_bases
ATGAATAGTCTAGAAAGCGGAAGTAACGTTCAGTCTGGATTAGAGATGATCATGGAGAAGAGTCCCGATACGATCGTATT
AGTAGATCGAAATCTTACTCTTGTCAAGGTTATTTCTGCAAAAGACGATTATTATCATTATTTAGCGAATAACTGTATCG
GAAAGCAACCTCAAGCGTTGTTCCCGGACGGGAAGAACTACGATCAATATGAGATCTATAGAGCTGCGGTTAAACGTGTT
TTCGAGGAGCAAGTGAAAGTGGATTTCTCTTTTGAGGTCTCTTTTGAGGGAAAGAACTATTATTATCTATCGCAAGCAAG
CCTTTTTAATGAGGAGCTTGTGATCGTTTATACACGCAATGTATCTTCTCTGAAAACAGAAAAAAATCTACAAGAACTGA
TCAATACGATATTAGATCGGTTACCGTTGGGTGTTTTCGTGAAAGATGGGGATAACCATTTTAATTACCTGTATTGGAAT
CATTTTATGGAGGAAATAACGGGTATTGAAACCCGGGAGATCGAGGGACATGATGATTTCGAGGTGAATTATAATGCCTT
GATGACCGCCGAGGAGCGTCTGGAAACCGATATGAATGTGATCAAGACAGGACTGACCGCTAGATTTAAGGGCAAGGTAA
AATCGGCCTCCGGCGATTACCGGGATATAGAGGTCGCTAAATATCCTATTTCCCTAAATAATGGCAAGCCGCTTGTCTTG
GCTTTATGGAGAGATATAACTTCCGAGTTGGCTACGGAGAATACTTTGAGAAGAACCCGGATCTTGACGAAAATGGCATT
GCGGATAAGTGATATACGTACATGCTCGATCTTCATCGATCCGGACAGTACCCATAATTTCAAGGATTCCGTTGTGACCT
TGAACGATTGGAATACCATGTCGGAAGATATGATAGAGGTGTCATGGGGGCAGTTTATCAGCCGGGCGCATCCGGATGAT
CAAGAACATTATCATAATATGTTTACCCGTCTTTGCCGAGGGGAAATCTCTGAGGCAAGGATCGAGGCACGTATGCTATT
TCCCGGCAAGAAGGAATATGTTTGGAGAGAGGTATTCGCTACCGTGTATGAACGGGACGATAAAGGAAGACCTTCGGTTA
TCCTTGGATGTTCAACGAATATTCAGGAACGGAAGAATCAAGAATTAAGCCTTGAGGAGGCGAAGGTGAAGGCTGAGGCC
GCTGATAAGATGAAATCGAAATATCTGGCGGATATGAGCCATGAGATCCGCACTCCTTTGAATGCGATTACCGGTTTCTC
TGAATTGATGGCTTTTGCTGATACGGATGAGGAACGTATGTCGTACTACGATGTGATCAAGATGAATAACCAATTGTTGA
TGCAATTGATCAATGACATCTTGGATATCTCGAAGATCGAGGCGGATGCGATAAAGATCACATATGAGCAATTAGATGTC
AGTGAATTGATGGATACGATTTATGCTTCCGCCAAGTTACGGGTTCCGGGAGGAGTCAAGTTGGTTTTGGAGAAAGAGGC
TGACCACCATATGTTCGGTACGGATAGCATGCGTCTGTTGCAGTTGATTAATAATTTGGTGAACAACGCTATCAAGAACA
CGAAAGAAGGTAGCATCACGATGGGATATACCATTCAACCGGATGATCAATTACGTTTTTACGTAAGGGATACGGGAATC
GGCATCGATAAGGAAAAATTGAAAGATGTCTTCGACCGTTTCGTGAAAATAAACGACTATATGGAAGGAATCGGATTAGG
ACTGGCTATCTGCAAAGGATTGGTTGTGAAGATGGGAGGTTCGATACATGTTACGTCTGAATTAGGGGTGGGTTCGGAGT
TCTCCTTTATTTTGCCGTCTCATGAATAG

Upstream 100 bases:

>100_bases
ATTTAGAAATATTATGCAATAGGTAGGTTTCTCTTTGGTGATAAATAGAAAAATAAATACCTTTATCCCCGAGTTATACC
CCAAAAACGAAAGAATTAAT

Downstream 100 bases:

>100_bases
CCCTATTTGTAATAGCGCTTATAAATCTGGTCGTATAATCCACTGTCTTTGATTTGCTGGAGCCAACTATTTAGGCTATC
CAGTAGGACAGGAGAGTCTT

Product: putative two-component system sensor histidine kinase

Products: NA

Alternate protein names: Capsular synthesis regulator component C [H]

Number of amino acids: Translated: 622; Mature: 622

Protein sequence:

>622_residues
MNSLESGSNVQSGLEMIMEKSPDTIVLVDRNLTLVKVISAKDDYYHYLANNCIGKQPQALFPDGKNYDQYEIYRAAVKRV
FEEQVKVDFSFEVSFEGKNYYYLSQASLFNEELVIVYTRNVSSLKTEKNLQELINTILDRLPLGVFVKDGDNHFNYLYWN
HFMEEITGIETREIEGHDDFEVNYNALMTAEERLETDMNVIKTGLTARFKGKVKSASGDYRDIEVAKYPISLNNGKPLVL
ALWRDITSELATENTLRRTRILTKMALRISDIRTCSIFIDPDSTHNFKDSVVTLNDWNTMSEDMIEVSWGQFISRAHPDD
QEHYHNMFTRLCRGEISEARIEARMLFPGKKEYVWREVFATVYERDDKGRPSVILGCSTNIQERKNQELSLEEAKVKAEA
ADKMKSKYLADMSHEIRTPLNAITGFSELMAFADTDEERMSYYDVIKMNNQLLMQLINDILDISKIEADAIKITYEQLDV
SELMDTIYASAKLRVPGGVKLVLEKEADHHMFGTDSMRLLQLINNLVNNAIKNTKEGSITMGYTIQPDDQLRFYVRDTGI
GIDKEKLKDVFDRFVKINDYMEGIGLGLAICKGLVVKMGGSIHVTSELGVGSEFSFILPSHE

Sequences:

>Translated_622_residues
MNSLESGSNVQSGLEMIMEKSPDTIVLVDRNLTLVKVISAKDDYYHYLANNCIGKQPQALFPDGKNYDQYEIYRAAVKRV
FEEQVKVDFSFEVSFEGKNYYYLSQASLFNEELVIVYTRNVSSLKTEKNLQELINTILDRLPLGVFVKDGDNHFNYLYWN
HFMEEITGIETREIEGHDDFEVNYNALMTAEERLETDMNVIKTGLTARFKGKVKSASGDYRDIEVAKYPISLNNGKPLVL
ALWRDITSELATENTLRRTRILTKMALRISDIRTCSIFIDPDSTHNFKDSVVTLNDWNTMSEDMIEVSWGQFISRAHPDD
QEHYHNMFTRLCRGEISEARIEARMLFPGKKEYVWREVFATVYERDDKGRPSVILGCSTNIQERKNQELSLEEAKVKAEA
ADKMKSKYLADMSHEIRTPLNAITGFSELMAFADTDEERMSYYDVIKMNNQLLMQLINDILDISKIEADAIKITYEQLDV
SELMDTIYASAKLRVPGGVKLVLEKEADHHMFGTDSMRLLQLINNLVNNAIKNTKEGSITMGYTIQPDDQLRFYVRDTGI
GIDKEKLKDVFDRFVKINDYMEGIGLGLAICKGLVVKMGGSIHVTSELGVGSEFSFILPSHE
>Mature_622_residues
MNSLESGSNVQSGLEMIMEKSPDTIVLVDRNLTLVKVISAKDDYYHYLANNCIGKQPQALFPDGKNYDQYEIYRAAVKRV
FEEQVKVDFSFEVSFEGKNYYYLSQASLFNEELVIVYTRNVSSLKTEKNLQELINTILDRLPLGVFVKDGDNHFNYLYWN
HFMEEITGIETREIEGHDDFEVNYNALMTAEERLETDMNVIKTGLTARFKGKVKSASGDYRDIEVAKYPISLNNGKPLVL
ALWRDITSELATENTLRRTRILTKMALRISDIRTCSIFIDPDSTHNFKDSVVTLNDWNTMSEDMIEVSWGQFISRAHPDD
QEHYHNMFTRLCRGEISEARIEARMLFPGKKEYVWREVFATVYERDDKGRPSVILGCSTNIQERKNQELSLEEAKVKAEA
ADKMKSKYLADMSHEIRTPLNAITGFSELMAFADTDEERMSYYDVIKMNNQLLMQLINDILDISKIEADAIKITYEQLDV
SELMDTIYASAKLRVPGGVKLVLEKEADHHMFGTDSMRLLQLINNLVNNAIKNTKEGSITMGYTIQPDDQLRFYVRDTGI
GIDKEKLKDVFDRFVKINDYMEGIGLGLAICKGLVVKMGGSIHVTSELGVGSEFSFILPSHE

Specific function: Member of the two-component regulatory system RcsC/RcsB involved in the regulation of the expression of genes involved in colanic acid capsule synthesis. Together with RcsF, RcsC probably functions as a membrane-associated protein kinase that phosphorylat

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cell inner membrane; Multi-pass membrane protein [H]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 response regulatory domain [H]

Homologues:

Organism=Escherichia coli, GI145693157, Length=252, Percent_Identity=37.6984126984127, Blast_Score=142, Evalue=8e-35,
Organism=Escherichia coli, GI48994928, Length=260, Percent_Identity=32.6923076923077, Blast_Score=130, Evalue=2e-31,
Organism=Escherichia coli, GI1788713, Length=249, Percent_Identity=30.1204819277108, Blast_Score=122, Evalue=6e-29,
Organism=Escherichia coli, GI87081816, Length=240, Percent_Identity=35.4166666666667, Blast_Score=122, Evalue=7e-29,
Organism=Escherichia coli, GI1789149, Length=249, Percent_Identity=34.5381526104418, Blast_Score=119, Evalue=7e-28,
Organism=Escherichia coli, GI1786600, Length=221, Percent_Identity=28.9592760180996, Blast_Score=91, Evalue=2e-19,
Organism=Escherichia coli, GI1786912, Length=248, Percent_Identity=24.5967741935484, Blast_Score=84, Evalue=4e-17,
Organism=Escherichia coli, GI1788393, Length=211, Percent_Identity=29.3838862559242, Blast_Score=83, Evalue=5e-17,
Organism=Escherichia coli, GI1788549, Length=232, Percent_Identity=25, Blast_Score=74, Evalue=2e-14,
Organism=Escherichia coli, GI1786783, Length=227, Percent_Identity=27.3127753303965, Blast_Score=72, Evalue=9e-14,
Organism=Escherichia coli, GI87082128, Length=233, Percent_Identity=24.8927038626609, Blast_Score=69, Evalue=9e-13,
Organism=Escherichia coli, GI1790436, Length=215, Percent_Identity=26.9767441860465, Blast_Score=68, Evalue=2e-12,
Organism=Escherichia coli, GI1787894, Length=224, Percent_Identity=26.7857142857143, Blast_Score=66, Evalue=5e-12,
Organism=Escherichia coli, GI1790861, Length=229, Percent_Identity=26.2008733624454, Blast_Score=66, Evalue=8e-12,
Organism=Escherichia coli, GI1790551, Length=191, Percent_Identity=29.8429319371728, Blast_Score=64, Evalue=3e-11,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR003594
- InterPro:   IPR011006
- InterPro:   IPR000014
- InterPro:   IPR004358
- InterPro:   IPR019017
- InterPro:   IPR003661
- InterPro:   IPR005467
- InterPro:   IPR009082
- InterPro:   IPR001789 [H]

Pfam domain/function: PF02518 HATPase_c; PF00512 HisKA; PF09456 RcsC; PF00072 Response_reg [H]

EC number: =2.7.13.3 [H]

Molecular weight: Translated: 71207; Mature: 71207

Theoretical pI: Translated: 4.86; Mature: 4.86

Prosite motif: PS50112 PAS ; PS50109 HIS_KIN

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.8 %Cys     (Translated Protein)
3.7 %Met     (Translated Protein)
4.5 %Cys+Met (Translated Protein)
0.8 %Cys     (Mature Protein)
3.7 %Met     (Mature Protein)
4.5 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MNSLESGSNVQSGLEMIMEKSPDTIVLVDRNLTLVKVISAKDDYYHYLANNCIGKQPQAL
CCCCCCCCCHHHHHHHHHHCCCCEEEEEECCCEEEEEEECCCHHHHHHHHCCCCCCCCCC
FPDGKNYDQYEIYRAAVKRVFEEQVKVDFSFEVSFEGKNYYYLSQASLFNEELVIVYTRN
CCCCCCCCHHHHHHHHHHHHHHHHHEEEEEEEEEECCCCEEEEECHHCCCCCEEEEEECC
VSSLKTEKNLQELINTILDRLPLGVFVKDGDNHFNYLYWNHFMEEITGIETREIEGHDDF
CHHHHHHHHHHHHHHHHHHHCCCEEEEECCCCCCEEEHHHHHHHHHCCCCEEECCCCCCC
EVNYNALMTAEERLETDMNVIKTGLTARFKGKVKSASGDYRDIEVAKYPISLNNGKPLVL
EECCCEEEEHHHHHHHHHHHHHHCCCEEECCCEECCCCCCCEEEEEEEEEEECCCCEEEE
ALWRDITSELATENTLRRTRILTKMALRISDIRTCSIFIDPDSTHNFKDSVVTLNDWNTM
EHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCEEEEEEECCCCCCCCCCCEEEEECCCCC
SEDMIEVSWGQFISRAHPDDQEHYHNMFTRLCRGEISEARIEARMLFPGKKEYVWREVFA
HHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHCCHHHHHEEEEEECCCCHHHHHHHHHH
TVYERDDKGRPSVILGCSTNIQERKNQELSLEEAKVKAEAADKMKSKYLADMSHEIRTPL
HHHHCCCCCCCCEEEECCCCHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCHH
NAITGFSELMAFADTDEERMSYYDVIKMNNQLLMQLINDILDISKIEADAIKITYEQLDV
HHHHCHHHHHHHCCCCHHHHHHHHHHHCCHHHHHHHHHHHHHHHHCCCCCEEEEHHHCCH
SELMDTIYASAKLRVPGGVKLVLEKEADHHMFGTDSMRLLQLINNLVNNAIKNTKEGSIT
HHHHHHHHHCCEEECCCCEEEEEECCCCCCCCCCCHHHHHHHHHHHHHHHHCCCCCCCEE
MGYTIQPDDQLRFYVRDTGIGIDKEKLKDVFDRFVKINDYMEGIGLGLAICKGLVVKMGG
EEEEECCCCCEEEEEEECCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCC
SIHVTSELGVGSEFSFILPSHE
CEEEEECCCCCCCEEEECCCCC
>Mature Secondary Structure
MNSLESGSNVQSGLEMIMEKSPDTIVLVDRNLTLVKVISAKDDYYHYLANNCIGKQPQAL
CCCCCCCCCHHHHHHHHHHCCCCEEEEEECCCEEEEEEECCCHHHHHHHHCCCCCCCCCC
FPDGKNYDQYEIYRAAVKRVFEEQVKVDFSFEVSFEGKNYYYLSQASLFNEELVIVYTRN
CCCCCCCCHHHHHHHHHHHHHHHHHEEEEEEEEEECCCCEEEEECHHCCCCCEEEEEECC
VSSLKTEKNLQELINTILDRLPLGVFVKDGDNHFNYLYWNHFMEEITGIETREIEGHDDF
CHHHHHHHHHHHHHHHHHHHCCCEEEEECCCCCCEEEHHHHHHHHHCCCCEEECCCCCCC
EVNYNALMTAEERLETDMNVIKTGLTARFKGKVKSASGDYRDIEVAKYPISLNNGKPLVL
EECCCEEEEHHHHHHHHHHHHHHCCCEEECCCEECCCCCCCEEEEEEEEEEECCCCEEEE
ALWRDITSELATENTLRRTRILTKMALRISDIRTCSIFIDPDSTHNFKDSVVTLNDWNTM
EHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCEEEEEEECCCCCCCCCCCEEEEECCCCC
SEDMIEVSWGQFISRAHPDDQEHYHNMFTRLCRGEISEARIEARMLFPGKKEYVWREVFA
HHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHCCHHHHHEEEEEECCCCHHHHHHHHHH
TVYERDDKGRPSVILGCSTNIQERKNQELSLEEAKVKAEAADKMKSKYLADMSHEIRTPL
HHHHCCCCCCCCEEEECCCCHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCHH
NAITGFSELMAFADTDEERMSYYDVIKMNNQLLMQLINDILDISKIEADAIKITYEQLDV
HHHHCHHHHHHHCCCCHHHHHHHHHHHCCHHHHHHHHHHHHHHHHCCCCCEEEEHHHCCH
SELMDTIYASAKLRVPGGVKLVLEKEADHHMFGTDSMRLLQLINNLVNNAIKNTKEGSIT
HHHHHHHHHCCEEECCCCEEEEEECCCCCCCCCCCHHHHHHHHHHHHHHHHCCCCCCCEE
MGYTIQPDDQLRFYVRDTGIGIDKEKLKDVFDRFVKINDYMEGIGLGLAICKGLVVKMGG
EEEEECCCCCEEEEEEECCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCC
SIHVTSELGVGSEFSFILPSHE
CEEEEECCCCCCCEEEECCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 2404948; 8366025; 9097040; 9278503; 11758943; 11309126; 13129944 [H]