| Definition | Azorhizobium caulinodans ORS 571, complete genome. |
|---|---|
| Accession | NC_009937 |
| Length | 5,369,772 |
Click here to switch to the map view.
The map label for this gene is edd [H]
Identifier: 158424048
GI number: 158424048
Start: 2752773
End: 2754614
Strand: Reverse
Name: edd [H]
Synonym: AZC_2424
Alternate gene names: 158424048
Gene position: 2754614-2752773 (Counterclockwise)
Preceding gene: 158424049
Following gene: 158424047
Centisome position: 51.3
GC content: 69.49
Gene sequence:
>1842_bases ATGGCCATCCAAGCCACCCTCAACGCCCGCGTCGGCGAGGTGACGGAACGTATCGTCCAACGCAGCAGCGGTCCCCGCCA GCGCTATCTCGACCGTATCGCCGCCGCCGGGGCCGAGGGGCCGCGCCGTCGGGCGCTCGGCTGCGCCAACCAGGCACACG GCTTTGCCGCCTGCGGTCCGGCCGACAAGGCAGAGCTTCGCGCGGGTGATGGCGCGAACCTCGCCATCGTCACCGCCTAT AACGACATGCTGAGCGCCCATCAGCCCTATGAGCGCTATCCTGACCTCATCCGCGCGGCCGCCCGTGAGGCCGGCGGCGT GGCGCAGGTGGCGGGCGGCGTGCCGGCCATGTGCGATGGCATCACGCAGGGCGAGGCGGGCATGGAGCTTTCGCTCTTCT CCCGCGAGGTGATCGCCCTCTCCACCGCCGTCGCCCTGTCGCACCAGACCTATGATTCCGCCGTCTTCCTTGGCATCTGC GACAAGATTGTGCCCGGCCTGGTCATCGGCGCGCTCTCCTTCGGCCATCTGCCCACCGTCTTCCTGCCGAGCGGCCCCAT GACCTCGGGCCTGCCCAATGACGAGAAGACGCGGGTGCGCCAGCTCTTCGCCGAGGGCAAGGTGGGGCGCGATGCGCTGC TGGAGGCCGAGTCCCAGTCCTATCACGGTCCGGGCACCTGCACCTTCTACGGCACCGCCAACACCAACCAGATGATGATG GAGATCATGGGCGTGCACCTGCCCGGCGCCTCCTTCATCAATCCCAACACCCCCTTGCGCGATGCCGTGACCCGCGAGGG CGTGAAGCGGGCGCTGGCCATCACCGCGCTCGGGAACCACTACACCCCGCTCGGCCGCATTCTGGATGAGCGCGCCTTTG TGAACGCGGTGGTCGGTCTGCACGCCACCGGCGGCTCCACCAATCACACGCTGCACCTCGTCGCCATGGCGGCGGCGGCG GGCATCACGCTGACCTGGGACGATTTCTCCGATCTCGCCGAGGTGGTGCCGCTGCTCGCCCGCGTCTATCCGAACGGCAA GGCGGACGTGAACCATTTCCACGCCGCCGGCGGCATGGGCTTCGTGATCCGCGAACTGCTCTCCGAAGGCCTGCTGCACG AGAATGTGGAGACCGTCTGGGGCACGGGTCTCTCCGGGTACACTTCGGAGCCGGCGCTGAACGAGGCCGGCCAGCTCACC TGGACCGACGGCGCCACCGCCACGGGCGACGAGGCGGTGCTGCGGCCCGTGGCCAAGCCCTTCCAGCCCACCGGCGGCCT CAAGGTGCTCGACGGCAATCTCGGCCGGGCGGTGAGCAAGACCTCCGCCGTCGCGCCCGAGCGCCACGTCATCGAGGCGC CCGCCCGCGTCTTCCACTCGCAGGAGGAGCTTCAGGCCGCCTTCAAGGCCGGCAGCCTCACGGGTGATTTCGTGGCGGTG GTGCGCTTCCAGGGGCCGAAGGCCAACGGCATGCCGGAACTGCACAAGCTGATGCCGCCGCTCGGCGTGCTGCAGGATCG CGGGCAGAAGGTGGCGCTCGTCACTGACGGGCGCATGTCGGGCGCCTCCGGCAAGGTGCCGTCCGCCATCCATGTAACGC CGGAAGCCGCCAATGGCGGCGCCATCGCCAAGATCAAGGATGGCGACATCGTCCGCTTCGATGGCGTGAACGGCCATCTG ACCGTGCTGGTGGACGAGGCCGAATGGGCCGCCCGTCCGCTCGCTGAGCAGGACCTTTCCGGTTCGCATGTGGGCGTGGG GCGCGAACTGTTCGCCCCGCTCCGTGCCGCCGTCGGCAGCGCCGAGCACGGCGCCACCATCTTCGACCGCACGGCGGCCT GA
Upstream 100 bases:
>100_bases ACCGCGTTGCGGTCCCATCTGGCTGGATCGCGCTCTAGCGGAGCGCCGCCCCGGTGATTAGGTTCGCCGGGACGGATCGC TCAAGCCAGGAGGCACCCCC
Downstream 100 bases:
>100_bases CCGGCCTTTTGCACGTGGGCTGCGGTGTCCGCATCGCTGCCCGCGTGGCATGGTTTGGTGGCCTGCGGGGCCGTCGTCGT GGAGAAACGTATGCGTGCTG
Product: phosphogluconate dehydratase
Products: NA
Alternate protein names: 6-phosphogluconate dehydratase [H]
Number of amino acids: Translated: 613; Mature: 612
Protein sequence:
>613_residues MAIQATLNARVGEVTERIVQRSSGPRQRYLDRIAAAGAEGPRRRALGCANQAHGFAACGPADKAELRAGDGANLAIVTAY NDMLSAHQPYERYPDLIRAAAREAGGVAQVAGGVPAMCDGITQGEAGMELSLFSREVIALSTAVALSHQTYDSAVFLGIC DKIVPGLVIGALSFGHLPTVFLPSGPMTSGLPNDEKTRVRQLFAEGKVGRDALLEAESQSYHGPGTCTFYGTANTNQMMM EIMGVHLPGASFINPNTPLRDAVTREGVKRALAITALGNHYTPLGRILDERAFVNAVVGLHATGGSTNHTLHLVAMAAAA GITLTWDDFSDLAEVVPLLARVYPNGKADVNHFHAAGGMGFVIRELLSEGLLHENVETVWGTGLSGYTSEPALNEAGQLT WTDGATATGDEAVLRPVAKPFQPTGGLKVLDGNLGRAVSKTSAVAPERHVIEAPARVFHSQEELQAAFKAGSLTGDFVAV VRFQGPKANGMPELHKLMPPLGVLQDRGQKVALVTDGRMSGASGKVPSAIHVTPEAANGGAIAKIKDGDIVRFDGVNGHL TVLVDEAEWAARPLAEQDLSGSHVGVGRELFAPLRAAVGSAEHGATIFDRTAA
Sequences:
>Translated_613_residues MAIQATLNARVGEVTERIVQRSSGPRQRYLDRIAAAGAEGPRRRALGCANQAHGFAACGPADKAELRAGDGANLAIVTAY NDMLSAHQPYERYPDLIRAAAREAGGVAQVAGGVPAMCDGITQGEAGMELSLFSREVIALSTAVALSHQTYDSAVFLGIC DKIVPGLVIGALSFGHLPTVFLPSGPMTSGLPNDEKTRVRQLFAEGKVGRDALLEAESQSYHGPGTCTFYGTANTNQMMM EIMGVHLPGASFINPNTPLRDAVTREGVKRALAITALGNHYTPLGRILDERAFVNAVVGLHATGGSTNHTLHLVAMAAAA GITLTWDDFSDLAEVVPLLARVYPNGKADVNHFHAAGGMGFVIRELLSEGLLHENVETVWGTGLSGYTSEPALNEAGQLT WTDGATATGDEAVLRPVAKPFQPTGGLKVLDGNLGRAVSKTSAVAPERHVIEAPARVFHSQEELQAAFKAGSLTGDFVAV VRFQGPKANGMPELHKLMPPLGVLQDRGQKVALVTDGRMSGASGKVPSAIHVTPEAANGGAIAKIKDGDIVRFDGVNGHL TVLVDEAEWAARPLAEQDLSGSHVGVGRELFAPLRAAVGSAEHGATIFDRTAA >Mature_612_residues AIQATLNARVGEVTERIVQRSSGPRQRYLDRIAAAGAEGPRRRALGCANQAHGFAACGPADKAELRAGDGANLAIVTAYN DMLSAHQPYERYPDLIRAAAREAGGVAQVAGGVPAMCDGITQGEAGMELSLFSREVIALSTAVALSHQTYDSAVFLGICD KIVPGLVIGALSFGHLPTVFLPSGPMTSGLPNDEKTRVRQLFAEGKVGRDALLEAESQSYHGPGTCTFYGTANTNQMMME IMGVHLPGASFINPNTPLRDAVTREGVKRALAITALGNHYTPLGRILDERAFVNAVVGLHATGGSTNHTLHLVAMAAAAG ITLTWDDFSDLAEVVPLLARVYPNGKADVNHFHAAGGMGFVIRELLSEGLLHENVETVWGTGLSGYTSEPALNEAGQLTW TDGATATGDEAVLRPVAKPFQPTGGLKVLDGNLGRAVSKTSAVAPERHVIEAPARVFHSQEELQAAFKAGSLTGDFVAVV RFQGPKANGMPELHKLMPPLGVLQDRGQKVALVTDGRMSGASGKVPSAIHVTPEAANGGAIAKIKDGDIVRFDGVNGHLT VLVDEAEWAARPLAEQDLSGSHVGVGRELFAPLRAAVGSAEHGATIFDRTAA
Specific function: KEY ENZYME IN THE ENTNER-DOUDOROFF PATHWAY. [C]
COG id: COG0129
COG function: function code EG; Dihydroxyacid dehydratase/phosphogluconate dehydratase
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the ilvD/edd family [H]
Homologues:
Organism=Escherichia coli, GI1788157, Length=602, Percent_Identity=63.4551495016611, Blast_Score=776, Evalue=0.0, Organism=Escherichia coli, GI48994964, Length=549, Percent_Identity=30.2367941712204, Blast_Score=197, Evalue=2e-51, Organism=Escherichia coli, GI2367371, Length=512, Percent_Identity=29.4921875, Blast_Score=140, Evalue=2e-34, Organism=Escherichia coli, GI1786464, Length=514, Percent_Identity=29.7665369649805, Blast_Score=131, Evalue=1e-31, Organism=Saccharomyces cerevisiae, GI6322476, Length=494, Percent_Identity=31.7813765182186, Blast_Score=192, Evalue=1e-49,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR004786 - InterPro: IPR015928 - InterPro: IPR000581 - InterPro: IPR020558 [H]
Pfam domain/function: PF00920 ILVD_EDD [H]
EC number: =4.2.1.12 [H]
Molecular weight: Translated: 64184; Mature: 64052
Theoretical pI: Translated: 6.43; Mature: 6.43
Prosite motif: PS00886 ILVD_EDD_1 ; PS00887 ILVD_EDD_2
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.8 %Cys (Translated Protein) 2.3 %Met (Translated Protein) 3.1 %Cys+Met (Translated Protein) 0.8 %Cys (Mature Protein) 2.1 %Met (Mature Protein) 2.9 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MAIQATLNARVGEVTERIVQRSSGPRQRYLDRIAAAGAEGPRRRALGCANQAHGFAACGP CEEEEECCCHHHHHHHHHHHCCCCCHHHHHHHHHHCCCCCCHHHHHCCCCCCCCCEECCC ADKAELRAGDGANLAIVTAYNDMLSAHQPYERYPDLIRAAAREAGGVAQVAGGVPAMCDG CCHHHCCCCCCCCEEEEEECHHHHHCCCCHHHHHHHHHHHHHHCCCHHHHHCCCCHHHCC ITQGEAGMELSLFSREVIALSTAVALSHQTYDSAVFLGICDKIVPGLVIGALSFGHLPTV CCCCCCCCEEHHHHHHHHHHHHHHHHHCCCCCCEEHHHHHHHHHHHHHHHHHHHCCCCEE FLPSGPMTSGLPNDEKTRVRQLFAEGKVGRDALLEAESQSYHGPGTCTFYGTANTNQMMM EECCCCCCCCCCCHHHHHHHHHHHCCCCCHHHHHCCCCCCCCCCEEEEEEECCCCHHHHH EIMGVHLPGASFINPNTPLRDAVTREGVKRALAITALGNHYTPLGRILDERAFVNAVVGL HHHHCCCCCCCCCCCCCCHHHHHHHHHHHHHHEEEECCCCCCHHHHHHHHHHHHHHHHEE HATGGSTNHTLHLVAMAAAAGITLTWDDFSDLAEVVPLLARVYPNGKADVNHFHAAGGMG EECCCCCCCEEEEEEEHHHCCCEEEECCHHHHHHHHHHHHHHCCCCCCCCCCEECCCCHH FVIRELLSEGLLHENVETVWGTGLSGYTSEPALNEAGQLTWTDGATATGDEAVLRPVAKP HHHHHHHHHCHHHCCCHHHHCCCCCCCCCCCCCCCCCCEEECCCCCCCCCHHHHHHHHCC FQPTGGLKVLDGNLGRAVSKTSAVAPERHVIEAPARVFHSQEELQAAFKAGSLTGDFVAV CCCCCCCEEEECCCCHHHHHHHCCCCCHHHHHHHHHHHCCHHHHHHHHHCCCCCCCEEEE VRFQGPKANGMPELHKLMPPLGVLQDRGQKVALVTDGRMSGASGKVPSAIHVTPEAANGG EEECCCCCCCCHHHHHHCCCHHHHHCCCCEEEEEECCCCCCCCCCCCCEEEECCCCCCCC AIAKIKDGDIVRFDGVNGHLTVLVDEAEWAARPLAEQDLSGSHVGVGRELFAPLRAAVGS EEEEECCCCEEEECCCCCEEEEEEECCHHHHCCCHHHCCCCCCCCCCHHHHHHHHHHHCC AEHGATIFDRTAA CCCCCEECCCCCC >Mature Secondary Structure AIQATLNARVGEVTERIVQRSSGPRQRYLDRIAAAGAEGPRRRALGCANQAHGFAACGP EEEEECCCHHHHHHHHHHHCCCCCHHHHHHHHHHCCCCCCHHHHHCCCCCCCCCEECCC ADKAELRAGDGANLAIVTAYNDMLSAHQPYERYPDLIRAAAREAGGVAQVAGGVPAMCDG CCHHHCCCCCCCCEEEEEECHHHHHCCCCHHHHHHHHHHHHHHCCCHHHHHCCCCHHHCC ITQGEAGMELSLFSREVIALSTAVALSHQTYDSAVFLGICDKIVPGLVIGALSFGHLPTV CCCCCCCCEEHHHHHHHHHHHHHHHHHCCCCCCEEHHHHHHHHHHHHHHHHHHHCCCCEE FLPSGPMTSGLPNDEKTRVRQLFAEGKVGRDALLEAESQSYHGPGTCTFYGTANTNQMMM EECCCCCCCCCCCHHHHHHHHHHHCCCCCHHHHHCCCCCCCCCCEEEEEEECCCCHHHHH EIMGVHLPGASFINPNTPLRDAVTREGVKRALAITALGNHYTPLGRILDERAFVNAVVGL HHHHCCCCCCCCCCCCCCHHHHHHHHHHHHHHEEEECCCCCCHHHHHHHHHHHHHHHHEE HATGGSTNHTLHLVAMAAAAGITLTWDDFSDLAEVVPLLARVYPNGKADVNHFHAAGGMG EECCCCCCCEEEEEEEHHHCCCEEEECCHHHHHHHHHHHHHHCCCCCCCCCCEECCCCHH FVIRELLSEGLLHENVETVWGTGLSGYTSEPALNEAGQLTWTDGATATGDEAVLRPVAKP HHHHHHHHHCHHHCCCHHHHCCCCCCCCCCCCCCCCCCEEECCCCCCCCCHHHHHHHHCC FQPTGGLKVLDGNLGRAVSKTSAVAPERHVIEAPARVFHSQEELQAAFKAGSLTGDFVAV CCCCCCCEEEECCCCHHHHHHHCCCCCHHHHHHHHHHHCCHHHHHHHHHCCCCCCCEEEE VRFQGPKANGMPELHKLMPPLGVLQDRGQKVALVTDGRMSGASGKVPSAIHVTPEAANGG EEECCCCCCCCHHHHHHCCCHHHHHCCCCEEEEEECCCCCCCCCCCCCEEEECCCCCCCC AIAKIKDGDIVRFDGVNGHLTVLVDEAEWAARPLAEQDLSGSHVGVGRELFAPLRAAVGS EEEEECCCCEEEECCCCCEEEEEEECCHHHHCCCHHHCCCCCCCCCCHHHHHHHHHHHCC AEHGATIFDRTAA CCCCCEECCCCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 10400573; 11481430 [H]