| Definition | Novosphingobium aromaticivorans DSM 12444 chromosome, complete genome. |
|---|---|
| Accession | NC_007794 |
| Length | 3,561,584 |
Click here to switch to the map view.
The map label for this gene is atoC [H]
Identifier: 87200063
GI number: 87200063
Start: 2185739
End: 2187115
Strand: Reverse
Name: atoC [H]
Synonym: Saro_2047
Alternate gene names: 87200063
Gene position: 2187115-2185739 (Counterclockwise)
Preceding gene: 87200064
Following gene: 87200062
Centisome position: 61.41
GC content: 64.2
Gene sequence:
>1377_bases ATGAGCGAAGCGAAGCCCGGACAGCGACCGGCACTGCTGATCGTCGAGGACGATCCCGGTCTGCAGGCGCAGTTGAAATG GGCGTACGAGGATTTCGACGTCTTCATCGCGGGCGACAGGGTAAGCGCGCTGACCCTGCTACGTTCGGTGGAACCGGCGG TCGTGACCCTCGACCTCGGGTTGCCGCCCGATCCTGACGGAACCACCGAGGGCTTTGCCGTGCTCGACGAGATCATGGCC CTGCGCCCCGACACCAAGGTGATCGTCGCAAGCGGCCACGGTGCCCGCGAAAGCGCGCTCAAGGCCATCGAGAAGGGGGC GTACGACTTCTACCAGAAGCCGGTGGACATCGATGCGTTGGGCCTGATCGTTCGCCGTGCGCTGCACCTTTCGCGGATCG AGTCCGAAAATCGCCATCTCGCGACCCGTGCAAGCACCGACAACAGGGTGCTGGGGCGCATGATCACCGCGGCACCCGAG ATGATCAAGGTGGCCCGCACAATCGAGCGCGTCGCCAATACCAGCGTCTCGGTGATGCTGCTGGGCGCGAGCGGCACCGG CAAGGAACTGTTGGCGCGCGGCCTGCATGATGCGTCCGGACGCGCACGCGGATCGTTTGTCGCGATCAACTGCGCGGCCA TTCCGGAGAATCTGCTCGAAAGCGAACTGTTCGGGCACGAGAAGGGAGCGTTTACCGGAGCGGTCAAGACGACCGAGGGC AAGATCGAACAGGCCAGCGGCGGCACGCTGTTCCTCGACGAAGTGGGCGACATTCCGCTCCAGCTTCAGGTCAAGCTGCT GCGCTTCCTGCAGGAACGGACGATCGAGCGCATCGGCGGGCGAAAGTCGATCGAGGTCGATACACGCATCGTCTGCGCCA CGCACCAGAACCTCGAGGCCATGATTGCCGATGGGCGGTTCCGCGAGGACCTTTACTATCGCCTCGCGGAAATCGTTGTG CGCATTCCCAGCCTGGCGGAGCGCCCCGGCGATGCGACGCTTCTCGCCAAGACCTTTCTCATGCGCTTTGCCAAGGAGAT GAACCCGCAGGTCAAGGGCTTCGCGCCGGATGCGCTGGCGGCGATCGACAGCTGGAACTGGCCCGGAAACGTCCGCGAGC TGGAGAACCGCGTCAAGCGTGCGGTCATCATGGCCGACGGCAGGCTGGTTACCGCAACCGATCTCGACCTGCCGGGAAAT GCGGACGAGGAATCATCGCCGCTCAACCTGAAGACCGCGCGCGAAGCGACTGACCGCAAGGTCATCCGCCACGCGCTCGC CCGCAGCGAAGGCAACATCTCCAGCACCGCGCGCCTGCTCGGCATCAGCAGGCCGACGCTTTATGATCTGCTCAAGCAGT ACGACCTCCAGAACTAG
Upstream 100 bases:
>100_bases TCGGTAGCCGCTTCACGGTGCGGCTGCCGCTGGCGGCGGCAAAGCCGTTGATGGATTCGATTGGCGGCAGCACAGGCTCC GCCGACAAGAAGGTGGCATG
Downstream 100 bases:
>100_bases GCGGCTGGCCGCCGGCCTGCTGCTTGTCGCGCTGGCGGTCGGGCCGGCGCGTGGAGGTACGTCCGTTGGCGATGCCCTCG CCAAGGCAAGGACCGCCCTG
Product: two component sigma-54 specific Fis family transcriptional regulator
Products: NA
Alternate protein names: Ornithine decarboxylase antizyme; Ornithine/arginine decarboxylase inhibitor [H]
Number of amino acids: Translated: 458; Mature: 457
Protein sequence:
>458_residues MSEAKPGQRPALLIVEDDPGLQAQLKWAYEDFDVFIAGDRVSALTLLRSVEPAVVTLDLGLPPDPDGTTEGFAVLDEIMA LRPDTKVIVASGHGARESALKAIEKGAYDFYQKPVDIDALGLIVRRALHLSRIESENRHLATRASTDNRVLGRMITAAPE MIKVARTIERVANTSVSVMLLGASGTGKELLARGLHDASGRARGSFVAINCAAIPENLLESELFGHEKGAFTGAVKTTEG KIEQASGGTLFLDEVGDIPLQLQVKLLRFLQERTIERIGGRKSIEVDTRIVCATHQNLEAMIADGRFREDLYYRLAEIVV RIPSLAERPGDATLLAKTFLMRFAKEMNPQVKGFAPDALAAIDSWNWPGNVRELENRVKRAVIMADGRLVTATDLDLPGN ADEESSPLNLKTAREATDRKVIRHALARSEGNISSTARLLGISRPTLYDLLKQYDLQN
Sequences:
>Translated_458_residues MSEAKPGQRPALLIVEDDPGLQAQLKWAYEDFDVFIAGDRVSALTLLRSVEPAVVTLDLGLPPDPDGTTEGFAVLDEIMA LRPDTKVIVASGHGARESALKAIEKGAYDFYQKPVDIDALGLIVRRALHLSRIESENRHLATRASTDNRVLGRMITAAPE MIKVARTIERVANTSVSVMLLGASGTGKELLARGLHDASGRARGSFVAINCAAIPENLLESELFGHEKGAFTGAVKTTEG KIEQASGGTLFLDEVGDIPLQLQVKLLRFLQERTIERIGGRKSIEVDTRIVCATHQNLEAMIADGRFREDLYYRLAEIVV RIPSLAERPGDATLLAKTFLMRFAKEMNPQVKGFAPDALAAIDSWNWPGNVRELENRVKRAVIMADGRLVTATDLDLPGN ADEESSPLNLKTAREATDRKVIRHALARSEGNISSTARLLGISRPTLYDLLKQYDLQN >Mature_457_residues SEAKPGQRPALLIVEDDPGLQAQLKWAYEDFDVFIAGDRVSALTLLRSVEPAVVTLDLGLPPDPDGTTEGFAVLDEIMAL RPDTKVIVASGHGARESALKAIEKGAYDFYQKPVDIDALGLIVRRALHLSRIESENRHLATRASTDNRVLGRMITAAPEM IKVARTIERVANTSVSVMLLGASGTGKELLARGLHDASGRARGSFVAINCAAIPENLLESELFGHEKGAFTGAVKTTEGK IEQASGGTLFLDEVGDIPLQLQVKLLRFLQERTIERIGGRKSIEVDTRIVCATHQNLEAMIADGRFREDLYYRLAEIVVR IPSLAERPGDATLLAKTFLMRFAKEMNPQVKGFAPDALAAIDSWNWPGNVRELENRVKRAVIMADGRLVTATDLDLPGNA DEESSPLNLKTAREATDRKVIRHALARSEGNISSTARLLGISRPTLYDLLKQYDLQN
Specific function: Member of the two-component regulatory system AtoS/AtoC involved in the transcriptional regulation of the ato genes for acetoacetate metabolism. Also an inhibitor of polyamine biosynthesis [H]
COG id: COG2204
COG function: function code T; Response regulator containing CheY-like receiver, AAA-type ATPase, and DNA-binding domains
Gene ontology:
Cell location: Cytoplasm (Probable) [H]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 1 sigma-54 factor interaction domain [H]
Homologues:
Organism=Escherichia coli, GI1788550, Length=454, Percent_Identity=41.8502202643172, Blast_Score=351, Evalue=5e-98, Organism=Escherichia coli, GI1790437, Length=447, Percent_Identity=41.1633109619687, Blast_Score=308, Evalue=3e-85, Organism=Escherichia coli, GI1788905, Length=453, Percent_Identity=38.1898454746137, Blast_Score=295, Evalue=6e-81, Organism=Escherichia coli, GI1790299, Length=487, Percent_Identity=37.3716632443532, Blast_Score=293, Evalue=2e-80, Organism=Escherichia coli, GI87082117, Length=255, Percent_Identity=47.843137254902, Blast_Score=250, Evalue=1e-67, Organism=Escherichia coli, GI1789087, Length=328, Percent_Identity=41.1585365853659, Blast_Score=246, Evalue=2e-66, Organism=Escherichia coli, GI1789233, Length=358, Percent_Identity=41.6201117318436, Blast_Score=242, Evalue=4e-65, Organism=Escherichia coli, GI87082152, Length=319, Percent_Identity=39.4984326018809, Blast_Score=221, Evalue=1e-58, Organism=Escherichia coli, GI87081872, Length=318, Percent_Identity=38.0503144654088, Blast_Score=216, Evalue=3e-57, Organism=Escherichia coli, GI1786524, Length=343, Percent_Identity=39.3586005830904, Blast_Score=211, Evalue=6e-56, Organism=Escherichia coli, GI1787583, Length=327, Percent_Identity=35.474006116208, Blast_Score=205, Evalue=6e-54, Organism=Escherichia coli, GI1789828, Length=354, Percent_Identity=31.3559322033898, Blast_Score=131, Evalue=7e-32, Organism=Escherichia coli, GI87081858, Length=337, Percent_Identity=27.893175074184, Blast_Score=131, Evalue=1e-31,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR003593 - InterPro: IPR011006 - InterPro: IPR020441 - InterPro: IPR009057 - InterPro: IPR002197 - InterPro: IPR002078 - InterPro: IPR001789 [H]
Pfam domain/function: PF02954 HTH_8; PF00072 Response_reg; PF00158 Sigma54_activat [H]
EC number: NA
Molecular weight: Translated: 50077; Mature: 49946
Theoretical pI: Translated: 5.99; Mature: 5.99
Prosite motif: PS50110 RESPONSE_REGULATORY ; PS00676 SIGMA54_INTERACT_2 ; PS00688 SIGMA54_INTERACT_3 ; PS50045 SIGMA54_INTERACT_4
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.4 %Cys (Translated Protein) 2.0 %Met (Translated Protein) 2.4 %Cys+Met (Translated Protein) 0.4 %Cys (Mature Protein) 1.8 %Met (Mature Protein) 2.2 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MSEAKPGQRPALLIVEDDPGLQAQLKWAYEDFDVFIAGDRVSALTLLRSVEPAVVTLDLG CCCCCCCCCCEEEEEECCCCCEEEEEEEEECEEEEEECCHHHHHHHHHCCCCEEEEEECC LPPDPDGTTEGFAVLDEIMALRPDTKVIVASGHGARESALKAIEKGAYDFYQKPVDIDAL CCCCCCCCCHHHHHHHHHHHCCCCCEEEEECCCCCHHHHHHHHHHCCHHHHCCCCCHHHH GLIVRRALHLSRIESENRHLATRASTDNRVLGRMITAAPEMIKVARTIERVANTSVSVML HHHHHHHHHHHHHCCCCCEEEEECCCCHHHHHHHHHHHHHHHHHHHHHHHHHCCCEEEEE LGASGTGKELLARGLHDASGRARGSFVAINCAAIPENLLESELFGHEKGAFTGAVKTTEG EECCCCCHHHHHHCCCCCCCCCCCCEEEEEEHHCCHHHHHHHHHCCCCCCEECEEECCCC KIEQASGGTLFLDEVGDIPLQLQVKLLRFLQERTIERIGGRKSIEVDTRIVCATHQNLEA CEEECCCCEEEEECCCCCCHHHHHHHHHHHHHHHHHHHCCCCEEEECCEEEEEECCCCHH MIADGRFREDLYYRLAEIVVRIPSLAERPGDATLLAKTFLMRFAKEMNPQVKGFAPDALA EECCCCHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHCCCCCCCCCCHHHH AIDSWNWPGNVRELENRVKRAVIMADGRLVTATDLDLPGNADEESSPLNLKTAREATDRK HHHCCCCCCCHHHHHHHHHHEEEEECCEEEEEECCCCCCCCCCCCCCCCCHHHHHHHHHH VIRHALARSEGNISSTARLLGISRPTLYDLLKQYDLQN HHHHHHHHCCCCHHHHHHHHCCCCHHHHHHHHHHCCCC >Mature Secondary Structure SEAKPGQRPALLIVEDDPGLQAQLKWAYEDFDVFIAGDRVSALTLLRSVEPAVVTLDLG CCCCCCCCCEEEEEECCCCCEEEEEEEEECEEEEEECCHHHHHHHHHCCCCEEEEEECC LPPDPDGTTEGFAVLDEIMALRPDTKVIVASGHGARESALKAIEKGAYDFYQKPVDIDAL CCCCCCCCCHHHHHHHHHHHCCCCCEEEEECCCCCHHHHHHHHHHCCHHHHCCCCCHHHH GLIVRRALHLSRIESENRHLATRASTDNRVLGRMITAAPEMIKVARTIERVANTSVSVML HHHHHHHHHHHHHCCCCCEEEEECCCCHHHHHHHHHHHHHHHHHHHHHHHHHCCCEEEEE LGASGTGKELLARGLHDASGRARGSFVAINCAAIPENLLESELFGHEKGAFTGAVKTTEG EECCCCCHHHHHHCCCCCCCCCCCCEEEEEEHHCCHHHHHHHHHCCCCCCEECEEECCCC KIEQASGGTLFLDEVGDIPLQLQVKLLRFLQERTIERIGGRKSIEVDTRIVCATHQNLEA CEEECCCCEEEEECCCCCCHHHHHHHHHHHHHHHHHHHCCCCEEEECCEEEEEECCCCHH MIADGRFREDLYYRLAEIVVRIPSLAERPGDATLLAKTFLMRFAKEMNPQVKGFAPDALA EECCCCHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHCCCCCCCCCCHHHH AIDSWNWPGNVRELENRVKRAVIMADGRLVTATDLDLPGNADEESSPLNLKTAREATDRK HHHCCCCCCCHHHHHHHHHHEEEEECCEEEEEECCCCCCCCCCCCCCCCCHHHHHHHHHH VIRHALARSEGNISSTARLLGISRPTLYDLLKQYDLQN HHHHHHHHCCCCHHHHHHHHCCCCHHHHHHHHHHCCCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: DNA [C]
Specific reaction: Protein + DNA = Protein-DNA [C]
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 9097040; 9278503; 8346225 [H]