| Definition | Chromobacterium violaceum ATCC 12472 chromosome, complete genome. |
|---|---|
| Accession | NC_005085 |
| Length | 4,751,080 |
Click here to switch to the map view.
The map label for this gene is yfhA [H]
Identifier: 34498603
GI number: 34498603
Start: 3430570
End: 3432897
Strand: Reverse
Name: yfhA [H]
Synonym: CV_3148
Alternate gene names: 34498603
Gene position: 3432897-3430570 (Counterclockwise)
Preceding gene: 34498605
Following gene: 34498602
Centisome position: 72.26
GC content: 70.32
Gene sequence:
>2328_bases ATGGACATTCCCACATACGATGTATCCCCGTTGCATGCACGGGCCGATCCGGCCGAGCGCGCGATAGGCCAGTCCGCGGT TTTCCAGCGGCTGCTGCAACTGGTGCGGCGGGTGGCGCCCACCGACAAGACGGTATTGATCTGGGGGCCGACCGGCGCCG GCAAGGAAGTCATTGCCCATGAGCTGCACCGCCACAGCCTGGTGGCCGGGCAGCCTTTCATCGATCTCAACTGCGCGGCG ATTCCCGAGCACCTGATGGAGGCCGAGCTGTTCGGCCACGCCCGCGGCGCCTTCACCGGCGCGCAGGGCAGCCGGGTCGG CCTGCTGGCCAGGGTAGGGCGCGGCACGCTGTTTCTGGACGAGATCGGCGAGTTGCCGCTGACGCTGCAGCCCAAATTGC TGCGGGTGCTGGAGACGCGCAGCTTTCGCCCGCTGGGCTCGGCCGAATCCCAGCATTTCGCCGGACGCGTGGTCGCCGCC ACGCATCGCGATCTGCAGGCCGCGGTGCGCGACGGACGGTTCCGGGAGGACTTGTATTACCGGCTGTCGGTATTCGTGCT CAGCCTGCCGGGGCTGGAGCAGCGCCGCGACGACATCCCCGCGCTGATCGAGCATTTCTGCGCGATGCAGCCGCGTCCGC TGCGCTTCGCCGCCGATGCCGTGACGCGTCTGCAGCACAGCCGCTGGCCGGGCAATGTGCGCCAGCTGCGCAGCCTGGTG GACCGGCTGGGCGTGCTGGCCGACGGTCCGCTGATCACCGCGGCGGCGCTGGACGAGTTCCTGGAACCGCAGGCCCACGC ATGGCATGCGGACGCCGCCGAACTGGCCGACGCGCTGCTGGCCTTGCCGGGAGAAGACAAGCTGGCGGCGGCCGAGACGC TGTTGCTCAACCGGGCATTGCATCTGAGCCGCGGCAACAAGGCCGCGGCCGCGCGCGCGCTGGGCGTCGGCCGCAAGGTG GTGGAGCGCCGGCTGGGCGCGCGGCAGGACAGGCGGCAGCAGTTGCGCCGCTTGCTGGACGAGGGCGGCCGCTTGATGGA CGGCGGCGATTTCGCCGCGGCCGAGCGCGAGTTGTCGCGCGGACTGGCGTTGCTGGAAAGCGCCTCATTGCAGGACGAGG CGAGGGAGGAGCACTTCCACCTGCTGCGCCAGCTCGGCATTTGCCACAGCGCGCGGCACGGCTGGTCCAGCGCGGAGGCG CTGTCCTGCTACGAAGCCGCGCTGGCCGTGGGCAAGGAGCTGGATTGCGAGCCGGAGATCATGTCCATCCTGTTCGGCAT CTGGACCAGCCAGCTGATGTCGCTGGAGCTGGACCGGGCTCGCGGCGCGGCGCAGCAGATGCTGCAGCGCGGTCAGGCCA CCGGGGACGCCAGCGCGCTGGCCGACGCCCATTTCGTGATGGCCAACACCCTGTTCTGGCTTGGCGATCACGCCGAGGTG CTGGCGTGCCTGGAGCGGGGCGGCCTGCTGGACGGCGGTCCCAGCCGGAGGATGGGAACCCAGGGTTTCGATCTGAGCGG CCTGGTGCTGACCTTCGAAGGGCTGGCGGCGTTTCAGCTGGGCCAGTTCGCCCAGGCGCGCACGGCGCTGGAGGCGCTGC GCTCGCGGCAGGGTAGCGAAGACCAGCCTTTCAGCCGCGCCATCGCCCTGCAGGGGGCGGTCTGGCTGGCCTGCCTGTTC GAAGACGAGGCGCTGGGCAGCCTCGCGACGCAGATGGAGGGGCTGTCGCGGCAACATGGTTTCGCCTTTTACCAGGGCGT CGCCCAGTTCTTCCTGGGCTGCCATCTGGCGCGGCGCGGCCAGCTCCGGGAAGCGGAGGCCGCGATGGAGGAGGGCTACC AAGGGCAGATGCTGCGCCATGGCGGCAAGCTGTTCCATTCTTTCTATGCCTGGCAGCGCAGCCGACTGCTGCTTGCCGCC GGGAGGGCGGAGGAGGCGCTGGCCTTGGCCGACCGCGGGCTGGAACTGGCGATGGCGCACAAGGAGCGAGCCTACCTCGG CGAATTGCTGATCGCGCGCGCGGACGCGCTGCGTGCCTTGGGCGATGAGTCCGGCGCCGAGCATGGCCTGCGCAGCGCAT TGACCACGGCGGAAGCGCTGGGCGCGGTGCCGCCCAGGGTGGAGGCCGCGACGCGGCTGGCGGAACTGCTGGCCGAGTCT GGAAGGGAAGAGCAGGCGCGGGCGTTGCTGGAGTCGGTTTTGCGGGCCTGCGACGGCTCCGCCGAGCCAGCCCATCCCGT GCTGCAATGGGCGCGCATCCGGCTCGGCAGCCTGCCGGGCGGGCGCGCCGACCACAACGCAACAACAGGTGCAAGCCATG GCTTTTGA
Upstream 100 bases:
>100_bases GGCATTCATTTTTTTCATCCTTGTCATTTTAAAAGTCGTTGGCATAATGCCTTGCCATGTTGGGCGCGCCCGCCGGGCGC GCCGCTTGCGCAAGGTGGCC
Downstream 100 bases:
>100_bases ACTTTCTCCCAGCGATCTGGAACCCTTGCTGCAAGGGGCGTGCTTTTTCGGCAGCGGCGGCGGCGGGACGATGATTTCCG CCCGCCATCTGGCGGCGAAC
Product: hypothetical protein
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 775; Mature: 775
Protein sequence:
>775_residues MDIPTYDVSPLHARADPAERAIGQSAVFQRLLQLVRRVAPTDKTVLIWGPTGAGKEVIAHELHRHSLVAGQPFIDLNCAA IPEHLMEAELFGHARGAFTGAQGSRVGLLARVGRGTLFLDEIGELPLTLQPKLLRVLETRSFRPLGSAESQHFAGRVVAA THRDLQAAVRDGRFREDLYYRLSVFVLSLPGLEQRRDDIPALIEHFCAMQPRPLRFAADAVTRLQHSRWPGNVRQLRSLV DRLGVLADGPLITAAALDEFLEPQAHAWHADAAELADALLALPGEDKLAAAETLLLNRALHLSRGNKAAAARALGVGRKV VERRLGARQDRRQQLRRLLDEGGRLMDGGDFAAAERELSRGLALLESASLQDEAREEHFHLLRQLGICHSARHGWSSAEA LSCYEAALAVGKELDCEPEIMSILFGIWTSQLMSLELDRARGAAQQMLQRGQATGDASALADAHFVMANTLFWLGDHAEV LACLERGGLLDGGPSRRMGTQGFDLSGLVLTFEGLAAFQLGQFAQARTALEALRSRQGSEDQPFSRAIALQGAVWLACLF EDEALGSLATQMEGLSRQHGFAFYQGVAQFFLGCHLARRGQLREAEAAMEEGYQGQMLRHGGKLFHSFYAWQRSRLLLAA GRAEEALALADRGLELAMAHKERAYLGELLIARADALRALGDESGAEHGLRSALTTAEALGAVPPRVEAATRLAELLAES GREEQARALLESVLRACDGSAEPAHPVLQWARIRLGSLPGGRADHNATTGASHGF
Sequences:
>Translated_775_residues MDIPTYDVSPLHARADPAERAIGQSAVFQRLLQLVRRVAPTDKTVLIWGPTGAGKEVIAHELHRHSLVAGQPFIDLNCAA IPEHLMEAELFGHARGAFTGAQGSRVGLLARVGRGTLFLDEIGELPLTLQPKLLRVLETRSFRPLGSAESQHFAGRVVAA THRDLQAAVRDGRFREDLYYRLSVFVLSLPGLEQRRDDIPALIEHFCAMQPRPLRFAADAVTRLQHSRWPGNVRQLRSLV DRLGVLADGPLITAAALDEFLEPQAHAWHADAAELADALLALPGEDKLAAAETLLLNRALHLSRGNKAAAARALGVGRKV VERRLGARQDRRQQLRRLLDEGGRLMDGGDFAAAERELSRGLALLESASLQDEAREEHFHLLRQLGICHSARHGWSSAEA LSCYEAALAVGKELDCEPEIMSILFGIWTSQLMSLELDRARGAAQQMLQRGQATGDASALADAHFVMANTLFWLGDHAEV LACLERGGLLDGGPSRRMGTQGFDLSGLVLTFEGLAAFQLGQFAQARTALEALRSRQGSEDQPFSRAIALQGAVWLACLF EDEALGSLATQMEGLSRQHGFAFYQGVAQFFLGCHLARRGQLREAEAAMEEGYQGQMLRHGGKLFHSFYAWQRSRLLLAA GRAEEALALADRGLELAMAHKERAYLGELLIARADALRALGDESGAEHGLRSALTTAEALGAVPPRVEAATRLAELLAES GREEQARALLESVLRACDGSAEPAHPVLQWARIRLGSLPGGRADHNATTGASHGF >Mature_775_residues MDIPTYDVSPLHARADPAERAIGQSAVFQRLLQLVRRVAPTDKTVLIWGPTGAGKEVIAHELHRHSLVAGQPFIDLNCAA IPEHLMEAELFGHARGAFTGAQGSRVGLLARVGRGTLFLDEIGELPLTLQPKLLRVLETRSFRPLGSAESQHFAGRVVAA THRDLQAAVRDGRFREDLYYRLSVFVLSLPGLEQRRDDIPALIEHFCAMQPRPLRFAADAVTRLQHSRWPGNVRQLRSLV DRLGVLADGPLITAAALDEFLEPQAHAWHADAAELADALLALPGEDKLAAAETLLLNRALHLSRGNKAAAARALGVGRKV VERRLGARQDRRQQLRRLLDEGGRLMDGGDFAAAERELSRGLALLESASLQDEAREEHFHLLRQLGICHSARHGWSSAEA LSCYEAALAVGKELDCEPEIMSILFGIWTSQLMSLELDRARGAAQQMLQRGQATGDASALADAHFVMANTLFWLGDHAEV LACLERGGLLDGGPSRRMGTQGFDLSGLVLTFEGLAAFQLGQFAQARTALEALRSRQGSEDQPFSRAIALQGAVWLACLF EDEALGSLATQMEGLSRQHGFAFYQGVAQFFLGCHLARRGQLREAEAAMEEGYQGQMLRHGGKLFHSFYAWQRSRLLLAA GRAEEALALADRGLELAMAHKERAYLGELLIARADALRALGDESGAEHGLRSALTTAEALGAVPPRVEAATRLAELLAES GREEQARALLESVLRACDGSAEPAHPVLQWARIRLGSLPGGRADHNATTGASHGF
Specific function: Probable member of a two-component regulatory system yfhA/yfhK [H]
COG id: COG2204
COG function: function code T; Response regulator containing CheY-like receiver, AAA-type ATPase, and DNA-binding domains
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 1 sigma-54 factor interaction domain [H]
Homologues:
Organism=Escherichia coli, GI1788905, Length=306, Percent_Identity=43.1372549019608, Blast_Score=229, Evalue=7e-61, Organism=Escherichia coli, GI1789233, Length=317, Percent_Identity=39.1167192429022, Blast_Score=223, Evalue=5e-59, Organism=Escherichia coli, GI1788550, Length=295, Percent_Identity=41.6949152542373, Blast_Score=220, Evalue=3e-58, Organism=Escherichia coli, GI1790299, Length=331, Percent_Identity=40.785498489426, Blast_Score=216, Evalue=4e-57, Organism=Escherichia coli, GI87082117, Length=233, Percent_Identity=49.3562231759657, Blast_Score=209, Evalue=4e-55, Organism=Escherichia coli, GI1790437, Length=315, Percent_Identity=40.6349206349206, Blast_Score=209, Evalue=8e-55, Organism=Escherichia coli, GI1789087, Length=313, Percent_Identity=40.5750798722045, Blast_Score=205, Evalue=8e-54, Organism=Escherichia coli, GI87082152, Length=248, Percent_Identity=46.3709677419355, Blast_Score=184, Evalue=3e-47, Organism=Escherichia coli, GI1786524, Length=325, Percent_Identity=37.5384615384615, Blast_Score=177, Evalue=3e-45, Organism=Escherichia coli, GI87081872, Length=285, Percent_Identity=38.5964912280702, Blast_Score=174, Evalue=2e-44, Organism=Escherichia coli, GI1787583, Length=238, Percent_Identity=40.3361344537815, Blast_Score=158, Evalue=1e-39, Organism=Escherichia coli, GI1789828, Length=330, Percent_Identity=32.4242424242424, Blast_Score=150, Evalue=2e-37, Organism=Escherichia coli, GI87081858, Length=301, Percent_Identity=28.9036544850498, Blast_Score=110, Evalue=2e-25,
Paralogues:
None
Copy number: 10-20 Molecules/Cell [C]
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR003593 - InterPro: IPR011006 - InterPro: IPR009057 - InterPro: IPR002078 - InterPro: IPR001789 [H]
Pfam domain/function: PF00072 Response_reg; PF00158 Sigma54_activat [H]
EC number: NA
Molecular weight: Translated: 84232; Mature: 84232
Theoretical pI: Translated: 6.69; Mature: 6.69
Prosite motif: PS50045 SIGMA54_INTERACT_4
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.2 %Cys (Translated Protein) 1.7 %Met (Translated Protein) 2.8 %Cys+Met (Translated Protein) 1.2 %Cys (Mature Protein) 1.7 %Met (Mature Protein) 2.8 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MDIPTYDVSPLHARADPAERAIGQSAVFQRLLQLVRRVAPTDKTVLIWGPTGAGKEVIAH CCCCCCCCCCCCCCCCHHHHHHCHHHHHHHHHHHHHHHCCCCCEEEEECCCCCCHHHHHH ELHRHSLVAGQPFIDLNCAAIPEHLMEAELFGHARGAFTGAQGSRVGLLARVGRGTLFLD HHHHHHHHCCCCCEECCHHHHHHHHHHHHHHHHHCCCCCCCCCCCCHHHHHHCCCEEEHH EIGELPLTLQPKLLRVLETRSFRPLGSAESQHFAGRVVAATHRDLQAAVRDGRFREDLYY HHCCCCCCCCHHHHHHHHHCCCCCCCCCCCHHHCCHHHHHHHHHHHHHHHCCCHHHHHHH RLSVFVLSLPGLEQRRDDIPALIEHFCAMQPRPLRFAADAVTRLQHSRWPGNVRQLRSLV HHHHHHHCCCCCHHHHCCHHHHHHHHHCCCCCCCHHHHHHHHHHHHCCCCCHHHHHHHHH DRLGVLADGPLITAAALDEFLEPQAHAWHADAAELADALLALPGEDKLAAAETLLLNRAL HHHCCCCCCCCHHHHHHHHHHCCCCCCCCCCHHHHHHHHHCCCCCCHHHHHHHHHHHHHH HLSRGNKAAAARALGVGRKVVERRLGARQDRRQQLRRLLDEGGRLMDGGDFAAAERELSR HHCCCCHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHCCCCEECCCCHHHHHHHHHH GLALLESASLQDEAREEHFHLLRQLGICHSARHGWSSAEALSCYEAALAVGKELDCEPEI HHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHCCCCCCCHHH MSILFGIWTSQLMSLELDRARGAAQQMLQRGQATGDASALADAHFVMANTLFWLGDHAEV HHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHCCCHHHH LACLERGGLLDGGPSRRMGTQGFDLSGLVLTFEGLAAFQLGQFAQARTALEALRSRQGSE HHHHHHCCCCCCCCCCCCCCCCCCCCCHHEEHHHHHHHHHHHHHHHHHHHHHHHHCCCCC DQPFSRAIALQGAVWLACLFEDEALGSLATQMEGLSRQHGFAFYQGVAQFFLGCHLARRG CCCHHHHHHHHHHHHHHHHHCHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHCC QLREAEAAMEEGYQGQMLRHGGKLFHSFYAWQRSRLLLAAGRAEEALALADRGLELAMAH CHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHCCEEEECCCHHHHHHHHHCCCHHHHHH KERAYLGELLIARADALRALGDESGAEHGLRSALTTAEALGAVPPRVEAATRLAELLAES HHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHC GREEQARALLESVLRACDGSAEPAHPVLQWARIRLGSLPGGRADHNATTGASHGF CCHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCC >Mature Secondary Structure MDIPTYDVSPLHARADPAERAIGQSAVFQRLLQLVRRVAPTDKTVLIWGPTGAGKEVIAH CCCCCCCCCCCCCCCCHHHHHHCHHHHHHHHHHHHHHHCCCCCEEEEECCCCCCHHHHHH ELHRHSLVAGQPFIDLNCAAIPEHLMEAELFGHARGAFTGAQGSRVGLLARVGRGTLFLD HHHHHHHHCCCCCEECCHHHHHHHHHHHHHHHHHCCCCCCCCCCCCHHHHHHCCCEEEHH EIGELPLTLQPKLLRVLETRSFRPLGSAESQHFAGRVVAATHRDLQAAVRDGRFREDLYY HHCCCCCCCCHHHHHHHHHCCCCCCCCCCCHHHCCHHHHHHHHHHHHHHHCCCHHHHHHH RLSVFVLSLPGLEQRRDDIPALIEHFCAMQPRPLRFAADAVTRLQHSRWPGNVRQLRSLV HHHHHHHCCCCCHHHHCCHHHHHHHHHCCCCCCCHHHHHHHHHHHHCCCCCHHHHHHHHH DRLGVLADGPLITAAALDEFLEPQAHAWHADAAELADALLALPGEDKLAAAETLLLNRAL HHHCCCCCCCCHHHHHHHHHHCCCCCCCCCCHHHHHHHHHCCCCCCHHHHHHHHHHHHHH HLSRGNKAAAARALGVGRKVVERRLGARQDRRQQLRRLLDEGGRLMDGGDFAAAERELSR HHCCCCHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHCCCCEECCCCHHHHHHHHHH GLALLESASLQDEAREEHFHLLRQLGICHSARHGWSSAEALSCYEAALAVGKELDCEPEI HHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHCCCCCCCHHH MSILFGIWTSQLMSLELDRARGAAQQMLQRGQATGDASALADAHFVMANTLFWLGDHAEV HHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHCCCHHHH LACLERGGLLDGGPSRRMGTQGFDLSGLVLTFEGLAAFQLGQFAQARTALEALRSRQGSE HHHHHHCCCCCCCCCCCCCCCCCCCCCHHEEHHHHHHHHHHHHHHHHHHHHHHHHCCCCC DQPFSRAIALQGAVWLACLFEDEALGSLATQMEGLSRQHGFAFYQGVAQFFLGCHLARRG CCCHHHHHHHHHHHHHHHHHCHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHCC QLREAEAAMEEGYQGQMLRHGGKLFHSFYAWQRSRLLLAAGRAEEALALADRGLELAMAH CHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHCCEEEECCCHHHHHHHHHCCCHHHHHH KERAYLGELLIARADALRALGDESGAEHGLRSALTTAEALGAVPPRVEAATRLAELLAES HHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHC GREEQARALLESVLRACDGSAEPAHPVLQWARIRLGSLPGGRADHNATTGASHGF CCHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCC
PDB accession: NA
Resolution: NA
Structure class: Alpha
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: DNA [C]
Specific reaction: Protein + DNA = Protein-DNA [C]
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 11206551; 11258796 [H]