| Definition | Herpetosiphon aurantiacus ATCC 23779 chromosome, complete genome. |
|---|---|
| Accession | NC_009972 |
| Length | 6,346,587 |
Click here to switch to the map view.
The map label for this gene is ydcR [C]
Identifier: 159898411
GI number: 159898411
Start: 2275514
End: 2276722
Strand: Reverse
Name: ydcR [C]
Synonym: Haur_1887
Alternate gene names: 159898411
Gene position: 2276722-2275514 (Counterclockwise)
Preceding gene: 159898412
Following gene: 159898410
Centisome position: 35.87
GC content: 49.55
Gene sequence:
>1209_bases ATGGCTGCGATTGCAACAACTCCTAGCCAATTTGAACTCGCTGCTTGGGCTAAGACCATCACACCCTCGGCGCTGCAAGA TATGCTTTCGGCAACTGCCAATCCTGAGGTTATTTCGTTTGCTCTGGGGCTACCCGCCCCAGAGCTGTTTCCTCGCCACC AATTTAGCCAATTGGCCAGCACGTTACTCGAAGCCGAACCTTTGGCGTTGCAATATGGCCCGCCAAGTACCACCCTCAAA ACGGCAATTGTTTCATTGATGGCGCAACGAGGGGTACGCTGTCGGCCCGAGCAAATCTTTCTGACCAATGGTGCGCAACA GGGCATGAACCTGTTGGTACGCTTGCTTTTGGCCGATGGCGGCAGCGTTTTGTTGGAAGATTGTATTTATACGGGCTTTC AGCAAGTGCTTGATCCATTTCAAGCTAAGTTGCTAACCGTGCCAACCAACCCTGAAACTGGTATGGATGTAGCAGCAGTC GAAGCTCATTTAGCTGCAGGCCAACGCCCAAGCTTAATCTATGCGATCAGCGATGGACACAACCCGCTTGGCGTGAGCAT GAGCCTCGCCCAACGCCAGCAGCTCGTTGAACTAGCCCAACAGTATCAAATTCCCATTATTGAAGATGATGCTTATGGCT TTTTAAGCTATCAGGCTGATACGATTGCCCCAATGCGAGCCTTAAGTGACGACTGGGTTTTATATATTGGCTCATTTTCG AAAATTCTAGCCCCATCGTTGCGGGTTGGTTGGTTAGTCGTACCCGAGTGGTTAATCGAACGCTTGTCGATCGTCAAAGA GGCGAGCGATATTGGTACAGCCACGCTGAGCCAACGTTTAGTCGCAGCCTATACCCAAACCCATCAATTAACTACGCATA TCGACCAATTATGTCAAATATATACAACTCGCCGCGATACAATGTTTAGCGCGTTGGAGCAGCATTTTCCGTCCCAAACC CGTTGGTATCAGCCTAGCCATGGCATGTTTATTTGGGTTGAACTGCCTACAACAGTTGATCCCTTTAAACTCCTAGACCG AGCGATCAACCAAGCGAAGGTGGCGTTTATCCCAGGCAGTGTGTTTGGTGTGGCGGGCAAATCGATGAGTACCAATGGAA TTCGCCTGAATTTTTCGAATGCCGATATTGACCAGATTAATGCGGGAATTGAGCGTTTAGCCACAATCATGCAAACCCTC AAAGCCTGA
Upstream 100 bases:
>100_bases AAATTATTCAGCGCAAAAATGCCATTGGCTTCGGCAGTGGCAACATCAAAGCACTCTTTGCCGCCGTCGAACGCGAGCAA GCTTTGCGGGGAAATCTCTA
Downstream 100 bases:
>100_bases GGATGTCCCAAATCTAACCCGAAAGGATCGTTGTGCGAGTTCTATTCACCACCAATCCTGGGGTTGGTCATCTCAACCCA ATGTTGCCGTTGGCGCATGC
Product: GntR family transcriptional regulator
Products: NA
Alternate protein names: AspB-1 [H]
Number of amino acids: Translated: 402; Mature: 401
Protein sequence:
>402_residues MAAIATTPSQFELAAWAKTITPSALQDMLSATANPEVISFALGLPAPELFPRHQFSQLASTLLEAEPLALQYGPPSTTLK TAIVSLMAQRGVRCRPEQIFLTNGAQQGMNLLVRLLLADGGSVLLEDCIYTGFQQVLDPFQAKLLTVPTNPETGMDVAAV EAHLAAGQRPSLIYAISDGHNPLGVSMSLAQRQQLVELAQQYQIPIIEDDAYGFLSYQADTIAPMRALSDDWVLYIGSFS KILAPSLRVGWLVVPEWLIERLSIVKEASDIGTATLSQRLVAAYTQTHQLTTHIDQLCQIYTTRRDTMFSALEQHFPSQT RWYQPSHGMFIWVELPTTVDPFKLLDRAINQAKVAFIPGSVFGVAGKSMSTNGIRLNFSNADIDQINAGIERLATIMQTL KA
Sequences:
>Translated_402_residues MAAIATTPSQFELAAWAKTITPSALQDMLSATANPEVISFALGLPAPELFPRHQFSQLASTLLEAEPLALQYGPPSTTLK TAIVSLMAQRGVRCRPEQIFLTNGAQQGMNLLVRLLLADGGSVLLEDCIYTGFQQVLDPFQAKLLTVPTNPETGMDVAAV EAHLAAGQRPSLIYAISDGHNPLGVSMSLAQRQQLVELAQQYQIPIIEDDAYGFLSYQADTIAPMRALSDDWVLYIGSFS KILAPSLRVGWLVVPEWLIERLSIVKEASDIGTATLSQRLVAAYTQTHQLTTHIDQLCQIYTTRRDTMFSALEQHFPSQT RWYQPSHGMFIWVELPTTVDPFKLLDRAINQAKVAFIPGSVFGVAGKSMSTNGIRLNFSNADIDQINAGIERLATIMQTL KA >Mature_401_residues AAIATTPSQFELAAWAKTITPSALQDMLSATANPEVISFALGLPAPELFPRHQFSQLASTLLEAEPLALQYGPPSTTLKT AIVSLMAQRGVRCRPEQIFLTNGAQQGMNLLVRLLLADGGSVLLEDCIYTGFQQVLDPFQAKLLTVPTNPETGMDVAAVE AHLAAGQRPSLIYAISDGHNPLGVSMSLAQRQQLVELAQQYQIPIIEDDAYGFLSYQADTIAPMRALSDDWVLYIGSFSK ILAPSLRVGWLVVPEWLIERLSIVKEASDIGTATLSQRLVAAYTQTHQLTTHIDQLCQIYTTRRDTMFSALEQHFPSQTR WYQPSHGMFIWVELPTTVDPFKLLDRAINQAKVAFIPGSVFGVAGKSMSTNGIRLNFSNADIDQINAGIERLATIMQTLK A
Specific function: Unknown
COG id: COG1167
COG function: function code KE; Transcriptional regulators containing a DNA-binding HTH domain and an aminotransferase domain (MocR family) and their eukaryotic orthologs
Gene ontology:
Cell location: Cytoplasm [H]
Metaboloic importance: Non Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the class-I pyridoxal-phosphate-dependent aminotransferase family [H]
Homologues:
Organism=Homo sapiens, GI7705897, Length=418, Percent_Identity=26.0765550239234, Blast_Score=153, Evalue=3e-37, Organism=Homo sapiens, GI33469970, Length=418, Percent_Identity=26.0765550239234, Blast_Score=153, Evalue=3e-37, Organism=Escherichia coli, GI1787710, Length=346, Percent_Identity=29.7687861271676, Blast_Score=156, Evalue=2e-39, Organism=Escherichia coli, GI1790797, Length=386, Percent_Identity=29.7927461139896, Blast_Score=139, Evalue=4e-34, Organism=Saccharomyces cerevisiae, GI6321000, Length=437, Percent_Identity=24.0274599542334, Blast_Score=86, Evalue=9e-18, Organism=Saccharomyces cerevisiae, GI6321236, Length=285, Percent_Identity=24.5614035087719, Blast_Score=76, Evalue=8e-15, Organism=Saccharomyces cerevisiae, GI6321929, Length=370, Percent_Identity=21.8918918918919, Blast_Score=74, Evalue=4e-14, Organism=Drosophila melanogaster, GI21356535, Length=397, Percent_Identity=25.1889168765743, Blast_Score=118, Evalue=6e-27,
Paralogues:
None
Copy number: 10-20 Molecules/Cell [C]
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR004839 - InterPro: IPR015424 - InterPro: IPR015421 - InterPro: IPR015422 [H]
Pfam domain/function: PF00155 Aminotran_1_2 [H]
EC number: NA
Molecular weight: Translated: 44060; Mature: 43929
Theoretical pI: Translated: 5.16; Mature: 5.16
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.7 %Cys (Translated Protein) 2.7 %Met (Translated Protein) 3.5 %Cys+Met (Translated Protein) 0.7 %Cys (Mature Protein) 2.5 %Met (Mature Protein) 3.2 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MAAIATTPSQFELAAWAKTITPSALQDMLSATANPEVISFALGLPAPELFPRHQFSQLAS CCCCCCCCCCHHHHHHHHHCCHHHHHHHHHCCCCCCCEEEEECCCCHHHCCHHHHHHHHH TLLEAEPLALQYGPPSTTLKTAIVSLMAQRGVRCRPEQIFLTNGAQQGMNLLVRLLLADG HHHCCCCCEEEECCCCHHHHHHHHHHHHHCCCCCCCCEEEEECCHHHHHHHHHHHHHHCC GSVLLEDCIYTGFQQVLDPFQAKLLTVPTNPETGMDVAAVEAHLAAGQRPSLIYAISDGH CHHHHHHHHHHHHHHHHHHHHHEEEECCCCCCCCCCHHHHHHHHHCCCCCCEEEEECCCC NPLGVSMSLAQRQQLVELAQQYQIPIIEDDAYGFLSYQADTIAPMRALSDDWVLYIGSFS CCCCCHHHHHHHHHHHHHHHHHCCCEEECCCCEEEEECCHHHHHHHHCCCCEEEEECCHH KILAPSLRVGWLVVPEWLIERLSIVKEASDIGTATLSQRLVAAYTQTHQLTTHIDQLCQI HHHCCCHHCCEEECHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHH YTTRRDTMFSALEQHFPSQTRWYQPSHGMFIWVELPTTVDPFKLLDRAINQAKVAFIPGS HHHHHHHHHHHHHHHCCCCCCCCCCCCCEEEEEECCCCCCHHHHHHHHHCCCEEEEECCH VFGVAGKSMSTNGIRLNFSNADIDQINAGIERLATIMQTLKA HHCCCCCCCCCCCEEEEECCCCHHHHHHHHHHHHHHHHHHCC >Mature Secondary Structure AAIATTPSQFELAAWAKTITPSALQDMLSATANPEVISFALGLPAPELFPRHQFSQLAS CCCCCCCCCHHHHHHHHHCCHHHHHHHHHCCCCCCCEEEEECCCCHHHCCHHHHHHHHH TLLEAEPLALQYGPPSTTLKTAIVSLMAQRGVRCRPEQIFLTNGAQQGMNLLVRLLLADG HHHCCCCCEEEECCCCHHHHHHHHHHHHHCCCCCCCCEEEEECCHHHHHHHHHHHHHHCC GSVLLEDCIYTGFQQVLDPFQAKLLTVPTNPETGMDVAAVEAHLAAGQRPSLIYAISDGH CHHHHHHHHHHHHHHHHHHHHHEEEECCCCCCCCCCHHHHHHHHHCCCCCCEEEEECCCC NPLGVSMSLAQRQQLVELAQQYQIPIIEDDAYGFLSYQADTIAPMRALSDDWVLYIGSFS CCCCCHHHHHHHHHHHHHHHHHCCCEEECCCCEEEEECCHHHHHHHHCCCCEEEEECCHH KILAPSLRVGWLVVPEWLIERLSIVKEASDIGTATLSQRLVAAYTQTHQLTTHIDQLCQI HHHCCCHHCCEEECHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHH YTTRRDTMFSALEQHFPSQTRWYQPSHGMFIWVELPTTVDPFKLLDRAINQAKVAFIPGS HHHHHHHHHHHHHHHCCCCCCCCCCCCCEEEEEECCCCCCHHHHHHHHHCCCEEEEECCH VFGVAGKSMSTNGIRLNFSNADIDQINAGIERLATIMQTLKA HHCCCCCCCCCCCEEEEECCCCHHHHHHHHHHHHHHHHHHCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: DNA [C]
Specific reaction: Protein + DNA = Protein-DNA [C]
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 8899719; 11427726 [H]