| Definition | Bacteroides thetaiotaomicron VPI-5482 chromosome, complete genome. |
|---|---|
| Accession | NC_004663 |
| Length | 6,260,361 |
Click here to switch to the map view.
The map label for this gene is yqhC [C]
Identifier: 29346170
GI number: 29346170
Start: 946776
End: 948464
Strand: Reverse
Name: yqhC [C]
Synonym: BT_0760
Alternate gene names: 29346170
Gene position: 948464-946776 (Counterclockwise)
Preceding gene: 29346172
Following gene: 29346169
Centisome position: 15.15
GC content: 33.81
Gene sequence:
>1689_bases ATGATGTATTTAAAGACAATATCTATTGCTGCATCTTTCTTAATAGCAACAATATTTGAGAATCAATCATACTTAGTTTT ATTGTTGATTGTAATAAGTTTCTATCTCTACTGGCATTTATTTCATTATCTTTCCATACAAAAAGAAAGAAATTTCCTCA AAGAAGAGAACCAGTATTTTATAGATTCTTTCCAAAGTATTCGAAATCCAATTACCTTAGTCCATGTTCCTTTACGAACG ATCTGTAGTGACACCTGTCCCGAGAATATGAAGAATGATTTATTACTAGCTATTCGGAATATAGAATGCTTAAATGAGAA TCTGGACAGATTGTCCGGATTGAAATATTTGCATAATCATCCCGAAGCCATGGACATTACCGAACATGAATTAGGAAGCT ATGTAAGAAGCAGAATTCAATCCCTACAAGGCTATGCAACGAATAAACACATAAAACTAATCATCAATACAAACTTCACC TATGCCAGTGTATGGTTTGACAAAAGCAAAGTCTCACCAATTATCGATAAATTCATAACTAATGCAATCGACTGTTCCAA ACCAAAAACAAACATTACATTACTGATTTCTATCAGTCAGGAACATTGGGAAATAAGTGTACCCGATTCAGGAGATGGTA AACTGACAAAGCTTTATAATCAAAATAAACATCGGTTGATGAGACAGACAACAGAATTTGAATGCGATTTTGCAAAAAGC ATATTATATAAGAAACTAACGAATTTGTGTAATGGAAAAATCATAGTAAACAGTACATATCATACTGTCACATTAAAGTT TCCAGTAAAATGCTCTTGTAAAAACCAATTAAATCATTCGGCATTGAGTATCACCAATCATACTGAGATTGAAAAGATAG ATCGTTTGCTTTCAAAGGCTCCCTGTAAAAGAAGTTCTCACAAGCCGACAGTCGTACTTGCCGACAGTAATGATGATTTC CGATCCTATCTGACAAGTTGTTTAACGGAAGAGTTTACTATTAAAAGTTTTAGAGATGGCATCGAAGCGATGGCTTACAT AAAAAATGAATATCCTGATTTAGTGATTTGTGATACAGAACTTCAAAACATGGATGGTGTCGAACTCTCATCAAGATTGA AAACATCTTGCGAAACATCAATCATACCTATCATACTTTATAGTTCGCATATAGATATTAACCAGCACAATAGAAGAAAG ACTTCTTTAGCCGATACATTCTTGCAACAGCCCTTTAGTGTAACAGATTTAAAGCTTGAAATGTCAATCCTTATCAAAAA CACTCGTTTTCTTCGAAAATCATTCTTACAACGATTATTTGGAGAAGAGTTTTTGGAGACAAAAGCGTCAGAAATATTGC AGGATGGTAAACACCCTTTGATAAGTAAAGTTACTAAAATCATTCTGGAAAATCTGAATAATGAAAAACTAACCATAGAC TCCATTGCCAAAGAGCTTGGAATTAGCCGGACAAGTCTTTACAACAAGTGGACGCAATTAACAGGCGAAGCACTTAACAA ATTCATTCTCAAAATCCGAATGGAAAAAGCGCATGAAATGTTAAAGAGTGGAAAATATCGCGTAAACGAAGTCCCAGAGA AAATCGGAATGAAAGATATGGATAACTTCCGCGAAAAATATAAGAAGTATTTCGGAAAGACACCAGTTGATACTATTAAA AACGTTTGA
Upstream 100 bases:
>100_bases ACAATTATGAAATCATAGTTGGCATATAATCTACTATGTCTTTTGAATTAGAAAGAAAAAGCAAACTCTTTAGGAGTGAC GTCATTTAAAATATAACAAC
Downstream 100 bases:
>100_bases AGTATTTATATTGAAAAGCAGTTTTAAATAAAACAACCTGAGACCGATAGAAGAATTGTTGACGCAATCAACCAAACTTC TTTTTATCGGGCTCAGGTAC
Product: two-component system response regulator
Products: NA
Alternate protein names: Two-Component System Response Regulator; Two-Component System Sensor Histidine Kinase/Response; Two Component Transcriptional Regulator AraC Family; Sensor Histidine Kinase/Response Regulator; Response Regulator Receiver Domain Protein; Response Regulator Receiver Domain-Containing Protein; Two-Component System Sensor Kinase/Response Regulator; Response Regulator Receiver Sensor Hybrid Histidine Kinase; Integral Membrane Sensor Hybrid Histidine Kinase; Two-Component System Sensor Histidine Kinase; Two Component Transcriptional Regulator Arac Family; Response Regulator Receiver; Two Component AraC Family Transcriptional Regulator; AraC Family/Two Component Family Regulatory Protein; AraC Family Transcriptional Regulator
Number of amino acids: Translated: 562; Mature: 562
Protein sequence:
>562_residues MMYLKTISIAASFLIATIFENQSYLVLLLIVISFYLYWHLFHYLSIQKERNFLKEENQYFIDSFQSIRNPITLVHVPLRT ICSDTCPENMKNDLLLAIRNIECLNENLDRLSGLKYLHNHPEAMDITEHELGSYVRSRIQSLQGYATNKHIKLIINTNFT YASVWFDKSKVSPIIDKFITNAIDCSKPKTNITLLISISQEHWEISVPDSGDGKLTKLYNQNKHRLMRQTTEFECDFAKS ILYKKLTNLCNGKIIVNSTYHTVTLKFPVKCSCKNQLNHSALSITNHTEIEKIDRLLSKAPCKRSSHKPTVVLADSNDDF RSYLTSCLTEEFTIKSFRDGIEAMAYIKNEYPDLVICDTELQNMDGVELSSRLKTSCETSIIPIILYSSHIDINQHNRRK TSLADTFLQQPFSVTDLKLEMSILIKNTRFLRKSFLQRLFGEEFLETKASEILQDGKHPLISKVTKIILENLNNEKLTID SIAKELGISRTSLYNKWTQLTGEALNKFILKIRMEKAHEMLKSGKYRVNEVPEKIGMKDMDNFREKYKKYFGKTPVDTIK NV
Sequences:
>Translated_562_residues MMYLKTISIAASFLIATIFENQSYLVLLLIVISFYLYWHLFHYLSIQKERNFLKEENQYFIDSFQSIRNPITLVHVPLRT ICSDTCPENMKNDLLLAIRNIECLNENLDRLSGLKYLHNHPEAMDITEHELGSYVRSRIQSLQGYATNKHIKLIINTNFT YASVWFDKSKVSPIIDKFITNAIDCSKPKTNITLLISISQEHWEISVPDSGDGKLTKLYNQNKHRLMRQTTEFECDFAKS ILYKKLTNLCNGKIIVNSTYHTVTLKFPVKCSCKNQLNHSALSITNHTEIEKIDRLLSKAPCKRSSHKPTVVLADSNDDF RSYLTSCLTEEFTIKSFRDGIEAMAYIKNEYPDLVICDTELQNMDGVELSSRLKTSCETSIIPIILYSSHIDINQHNRRK TSLADTFLQQPFSVTDLKLEMSILIKNTRFLRKSFLQRLFGEEFLETKASEILQDGKHPLISKVTKIILENLNNEKLTID SIAKELGISRTSLYNKWTQLTGEALNKFILKIRMEKAHEMLKSGKYRVNEVPEKIGMKDMDNFREKYKKYFGKTPVDTIK NV >Mature_562_residues MMYLKTISIAASFLIATIFENQSYLVLLLIVISFYLYWHLFHYLSIQKERNFLKEENQYFIDSFQSIRNPITLVHVPLRT ICSDTCPENMKNDLLLAIRNIECLNENLDRLSGLKYLHNHPEAMDITEHELGSYVRSRIQSLQGYATNKHIKLIINTNFT YASVWFDKSKVSPIIDKFITNAIDCSKPKTNITLLISISQEHWEISVPDSGDGKLTKLYNQNKHRLMRQTTEFECDFAKS ILYKKLTNLCNGKIIVNSTYHTVTLKFPVKCSCKNQLNHSALSITNHTEIEKIDRLLSKAPCKRSSHKPTVVLADSNDDF RSYLTSCLTEEFTIKSFRDGIEAMAYIKNEYPDLVICDTELQNMDGVELSSRLKTSCETSIIPIILYSSHIDINQHNRRK TSLADTFLQQPFSVTDLKLEMSILIKNTRFLRKSFLQRLFGEEFLETKASEILQDGKHPLISKVTKIILENLNNEKLTID SIAKELGISRTSLYNKWTQLTGEALNKFILKIRMEKAHEMLKSGKYRVNEVPEKIGMKDMDNFREKYKKYFGKTPVDTIK NV
Specific function: Unknown
COG id: COG4753
COG function: function code T; Response regulator containing CheY-like receiver domain and AraC-type DNA-binding domain
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: NA
Homologues:
None
Paralogues:
None
Copy number: 10-20 Molecules/Cell [C]
Swissprot (AC and ID): NA
Other databases:
NA
Pfam domain/function: NA
EC number: NA
Molecular weight: Translated: 65087; Mature: 65087
Theoretical pI: Translated: 8.89; Mature: 8.89
Prosite motif: PS50110 RESPONSE_REGULATORY ; PS01124 HTH_ARAC_FAMILY_2
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
2.1 %Cys (Translated Protein) 2.1 %Met (Translated Protein) 4.3 %Cys+Met (Translated Protein) 2.1 %Cys (Mature Protein) 2.1 %Met (Mature Protein) 4.3 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MMYLKTISIAASFLIATIFENQSYLVLLLIVISFYLYWHLFHYLSIQKERNFLKEENQYF CCEEHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHH IDSFQSIRNPITLVHVPLRTICSDTCPENMKNDLLLAIRNIECLNENLDRLSGLKYLHNH HHHHHHHCCCEEEEEECHHHHHCCCCCCCCCCCCEEHHHHHHHHHHHHHHHHHHHHHHCC PEAMDITEHELGSYVRSRIQSLQGYATNKHIKLIINTNFTYASVWFDKSKVSPIIDKFIT CCCCCCHHHHHHHHHHHHHHHHHCCCCCCEEEEEEECCCEEEEEEECCCCCCHHHHHHHH NAIDCSKPKTNITLLISISQEHWEISVPDSGDGKLTKLYNQNKHRLMRQTTEFECDFAKS HHHCCCCCCCCEEEEEEECCCCEEEECCCCCCCCCHHHHCCHHHHHHHHHHCCCHHHHHH ILYKKLTNLCNGKIIVNSTYHTVTLKFPVKCSCKNQLNHSALSITNHTEIEKIDRLLSKA HHHHHHHHHCCCEEEEECCEEEEEEEECCEECCCCCCCCCCEEECCCHHHHHHHHHHHHC PCKRSSHKPTVVLADSNDDFRSYLTSCLTEEFTIKSFRDGIEAMAYIKNEYPDLVICDTE CCCCCCCCCEEEEECCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCEEEECCH LQNMDGVELSSRLKTSCETSIIPIILYSSHIDINQHNRRKTSLADTFLQQPFSVTDLKLE HCCCCCCHHHHHHHHHCCCCEEEEEEEECCCCCCCCCCHHHHHHHHHHHCCCCCCHHEEE MSILIKNTRFLRKSFLQRLFGEEFLETKASEILQDGKHPLISKVTKIILENLNNEKLTID EHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHCCCCCEEEHH SIAKELGISRTSLYNKWTQLTGEALNKFILKIRMEKAHEMLKSGKYRVNEVPEKIGMKDM HHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHCHHHCCCCCH DNFREKYKKYFGKTPVDTIKNV HHHHHHHHHHHCCCCHHHHCCC >Mature Secondary Structure MMYLKTISIAASFLIATIFENQSYLVLLLIVISFYLYWHLFHYLSIQKERNFLKEENQYF CCEEHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHH IDSFQSIRNPITLVHVPLRTICSDTCPENMKNDLLLAIRNIECLNENLDRLSGLKYLHNH HHHHHHHCCCEEEEEECHHHHHCCCCCCCCCCCCEEHHHHHHHHHHHHHHHHHHHHHHCC PEAMDITEHELGSYVRSRIQSLQGYATNKHIKLIINTNFTYASVWFDKSKVSPIIDKFIT CCCCCCHHHHHHHHHHHHHHHHHCCCCCCEEEEEEECCCEEEEEEECCCCCCHHHHHHHH NAIDCSKPKTNITLLISISQEHWEISVPDSGDGKLTKLYNQNKHRLMRQTTEFECDFAKS HHHCCCCCCCCEEEEEEECCCCEEEECCCCCCCCCHHHHCCHHHHHHHHHHCCCHHHHHH ILYKKLTNLCNGKIIVNSTYHTVTLKFPVKCSCKNQLNHSALSITNHTEIEKIDRLLSKA HHHHHHHHHCCCEEEEECCEEEEEEEECCEECCCCCCCCCCEEECCCHHHHHHHHHHHHC PCKRSSHKPTVVLADSNDDFRSYLTSCLTEEFTIKSFRDGIEAMAYIKNEYPDLVICDTE CCCCCCCCCEEEEECCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCEEEECCH LQNMDGVELSSRLKTSCETSIIPIILYSSHIDINQHNRRKTSLADTFLQQPFSVTDLKLE HCCCCCCHHHHHHHHHCCCCEEEEEEEECCCCCCCCCCHHHHHHHHHHHCCCCCCHHEEE MSILIKNTRFLRKSFLQRLFGEEFLETKASEILQDGKHPLISKVTKIILENLNNEKLTID EHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHCCCCCEEEHH SIAKELGISRTSLYNKWTQLTGEALNKFILKIRMEKAHEMLKSGKYRVNEVPEKIGMKDM HHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHCHHHCCCCCH DNFREKYKKYFGKTPVDTIKNV HHHHHHHHHHHCCCCHHHHCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: DNA [C]
Specific reaction: Protein + DNA = Protein-DNA [C]
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: NA