Definition Bacillus subtilis subsp. subtilis str. 168 chromosome, complete genome.
Accession NC_000964
Length 4,215,606

Click here to switch to the map view.

The map label for this gene is ilvD

Identifier: 255767479

GI number: 255767479

Start: 2300762

End: 2302438

Strand: Reverse

Name: ilvD

Synonym: BSU21870

Alternate gene names: 255767479

Gene position: 2302438-2300762 (Counterclockwise)

Preceding gene: 16079247

Following gene: 16079245

Centisome position: 54.62

GC content: 49.08

Gene sequence:

>1677_bases
ATGGCAGAATTACGCAGTAATATGATCACACAAGGAATCGATAGAGCTCCGCACCGCAGTTTGCTTCGTGCAGCAGGGGT
AAAAGAAGAGGATTTCGGCAAGCCGTTTATTGCGGTGTGTAATTCATACATTGATATCGTTCCCGGTCATGTTCACTTGC
AGGAGTTTGGGAAAATCGTAAAAGAAGCAATCAGAGAAGCAGGGGGCGTTCCGTTTGAATTTAATACCATTGGGGTAGAT
GATGGCATCGCAATGGGGCATATCGGTATGAGATATTCGCTGCCAAGCCGTGAAATTATCGCAGACTCTGTGGAAACGGT
TGTATCCGCACACTGGTTTGACGGAATGGTCTGTATTCCGAACTGCGACAAAATCACACCGGGAATGCTTATGGCGGCAA
TGCGCATCAACATTCCGACGATTTTTGTCAGCGGCGGACCGATGGCGGCAGGAAGAACAAGTGACGGGCGAAAAATCTCC
CTTTCCTCAGTATTCGAAGGGGTAGGCGCCTACCAAGCAGGGAAAATCAACGAAAACGAGCTTCAAGAACTAGAGCAGTT
CGGATGCCCAACGTGCGGGTCTTGCTCAGGCATGTTTACGGCGAACTCAATGAACTGTCTGTCAGAAGCACTTGGTCTTG
CTTTGCCGGGTAATGGAACCATTCTGGCAACATCTCCGGAACGCAAAGAGTTTGTGAGAAAATCGGCTGCGCAATTAATG
GAAACGATTCGCAAAGATATCAAACCGCGTGATATTGTTACAGTAAAAGCGATTGATAACGCGTTTGCACTCGATATGGC
GCTCGGAGGTTCTACAAATACCGTTCTTCATACCCTTGCCCTTGCAAACGAAGCCGGCGTTGAATACTCTTTAGAACGCA
TTAACGAAGTCGCTGAGCGCGTGCCGCACTTGGCTAAGCTGGCGCCTGCATCGGATGTGTTTATTGAAGATCTTCACGAA
GCGGGCGGCGTTTCAGCGGCTCTGAATGAGCTTTCGAAGAAAGAAGGAGCGCTTCATTTAGATGCGCTGACTGTTACAGG
AAAAACTCTTGGAGAAACCATTGCCGGACATGAAGTAAAGGATTATGACGTCATTCACCCGCTGGATCAACCATTCACTG
AAAAGGGAGGCCTTGCTGTTTTATTCGGTAATCTAGCTCCGGACGGCGCTATCATTAAAACAGGCGGCGTACAGAATGGG
ATTACAAGACACGAAGGGCCGGCTGTCGTATTCGATTCTCAGGACGAGGCGCTTGACGGCATTATCAACCGAAAAGTAAA
AGAAGGCGACGTTGTCATCATCAGATACGAAGGGCCAAAAGGCGGACCTGGCATGCCGGAAATGCTGGCGCCAACATCCC
AAATCGTTGGAATGGGACTCGGGCCAAAAGTGGCATTGATTACGGACGGACGTTTTTCCGGAGCCTCCCGTGGCCTCTCA
ATCGGCCACGTATCACCTGAGGCCGCTGAGGGCGGGCCGCTTGCCTTTGTTGAAAACGGAGACCATATTATCGTTGATAT
TGAAAAACGCATCTTGGATGTACAAGTGCCAGAAGAAGAGTGGGAAAAACGAAAAGCGAACTGGAAAGGTTTTGAACCGA
AAGTGAAAACCGGCTACCTGGCACGTTATTCTAAACTTGTGACAAGTGCCAACACCGGCGGTATTATGAAAATCTAG

Upstream 100 bases:

>100_bases
GGCCTGTATTTATCTTATTTGCAAAAACAGCCCATAAATAAACTGAAAATTGTCAAAATAAAATCCAATCAAACAATTGA
AAGAATTTAGGAGGATCACC

Downstream 100 bases:

>100_bases
ATAGCTGGGGACACTTTCTTTTATTTTAAGGCGTGAACATTTGAAATCCGGCCCTCTCTATAGTATCCTTTACTTCAGAT
GAAGGATACTAGAGGGGGCT

Product: dihydroxy-acid dehydratase

Products: NA

Alternate protein names: DAD [H]

Number of amino acids: Translated: 558; Mature: 557

Protein sequence:

>558_residues
MAELRSNMITQGIDRAPHRSLLRAAGVKEEDFGKPFIAVCNSYIDIVPGHVHLQEFGKIVKEAIREAGGVPFEFNTIGVD
DGIAMGHIGMRYSLPSREIIADSVETVVSAHWFDGMVCIPNCDKITPGMLMAAMRINIPTIFVSGGPMAAGRTSDGRKIS
LSSVFEGVGAYQAGKINENELQELEQFGCPTCGSCSGMFTANSMNCLSEALGLALPGNGTILATSPERKEFVRKSAAQLM
ETIRKDIKPRDIVTVKAIDNAFALDMALGGSTNTVLHTLALANEAGVEYSLERINEVAERVPHLAKLAPASDVFIEDLHE
AGGVSAALNELSKKEGALHLDALTVTGKTLGETIAGHEVKDYDVIHPLDQPFTEKGGLAVLFGNLAPDGAIIKTGGVQNG
ITRHEGPAVVFDSQDEALDGIINRKVKEGDVVIIRYEGPKGGPGMPEMLAPTSQIVGMGLGPKVALITDGRFSGASRGLS
IGHVSPEAAEGGPLAFVENGDHIIVDIEKRILDVQVPEEEWEKRKANWKGFEPKVKTGYLARYSKLVTSANTGGIMKI

Sequences:

>Translated_558_residues
MAELRSNMITQGIDRAPHRSLLRAAGVKEEDFGKPFIAVCNSYIDIVPGHVHLQEFGKIVKEAIREAGGVPFEFNTIGVD
DGIAMGHIGMRYSLPSREIIADSVETVVSAHWFDGMVCIPNCDKITPGMLMAAMRINIPTIFVSGGPMAAGRTSDGRKIS
LSSVFEGVGAYQAGKINENELQELEQFGCPTCGSCSGMFTANSMNCLSEALGLALPGNGTILATSPERKEFVRKSAAQLM
ETIRKDIKPRDIVTVKAIDNAFALDMALGGSTNTVLHTLALANEAGVEYSLERINEVAERVPHLAKLAPASDVFIEDLHE
AGGVSAALNELSKKEGALHLDALTVTGKTLGETIAGHEVKDYDVIHPLDQPFTEKGGLAVLFGNLAPDGAIIKTGGVQNG
ITRHEGPAVVFDSQDEALDGIINRKVKEGDVVIIRYEGPKGGPGMPEMLAPTSQIVGMGLGPKVALITDGRFSGASRGLS
IGHVSPEAAEGGPLAFVENGDHIIVDIEKRILDVQVPEEEWEKRKANWKGFEPKVKTGYLARYSKLVTSANTGGIMKI
>Mature_557_residues
AELRSNMITQGIDRAPHRSLLRAAGVKEEDFGKPFIAVCNSYIDIVPGHVHLQEFGKIVKEAIREAGGVPFEFNTIGVDD
GIAMGHIGMRYSLPSREIIADSVETVVSAHWFDGMVCIPNCDKITPGMLMAAMRINIPTIFVSGGPMAAGRTSDGRKISL
SSVFEGVGAYQAGKINENELQELEQFGCPTCGSCSGMFTANSMNCLSEALGLALPGNGTILATSPERKEFVRKSAAQLME
TIRKDIKPRDIVTVKAIDNAFALDMALGGSTNTVLHTLALANEAGVEYSLERINEVAERVPHLAKLAPASDVFIEDLHEA
GGVSAALNELSKKEGALHLDALTVTGKTLGETIAGHEVKDYDVIHPLDQPFTEKGGLAVLFGNLAPDGAIIKTGGVQNGI
TRHEGPAVVFDSQDEALDGIINRKVKEGDVVIIRYEGPKGGPGMPEMLAPTSQIVGMGLGPKVALITDGRFSGASRGLSI
GHVSPEAAEGGPLAFVENGDHIIVDIEKRILDVQVPEEEWEKRKANWKGFEPKVKTGYLARYSKLVTSANTGGIMKI

Specific function: Valine and isoleucine biosynthesis; fourth step. [C]

COG id: COG0129

COG function: function code EG; Dihydroxyacid dehydratase/phosphogluconate dehydratase

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the ilvD/edd family [H]

Homologues:

Organism=Escherichia coli, GI48994964, Length=609, Percent_Identity=47.4548440065681, Blast_Score=540, Evalue=1e-154,
Organism=Escherichia coli, GI1788157, Length=540, Percent_Identity=33.1481481481482, Blast_Score=226, Evalue=4e-60,
Organism=Escherichia coli, GI2367371, Length=518, Percent_Identity=32.2393822393822, Blast_Score=200, Evalue=2e-52,
Organism=Escherichia coli, GI1786464, Length=503, Percent_Identity=32.6043737574553, Blast_Score=197, Evalue=1e-51,
Organism=Saccharomyces cerevisiae, GI6322476, Length=560, Percent_Identity=39.6428571428571, Blast_Score=407, Evalue=1e-114,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR015928
- InterPro:   IPR004404
- InterPro:   IPR000581
- InterPro:   IPR020558 [H]

Pfam domain/function: PF00920 ILVD_EDD [H]

EC number: =4.2.1.9 [H]

Molecular weight: Translated: 59501; Mature: 59370

Theoretical pI: Translated: 5.29; Mature: 5.29

Prosite motif: PS00886 ILVD_EDD_1 ; PS00887 ILVD_EDD_2

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.3 %Cys     (Translated Protein)
3.0 %Met     (Translated Protein)
4.3 %Cys+Met (Translated Protein)
1.3 %Cys     (Mature Protein)
2.9 %Met     (Mature Protein)
4.1 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MAELRSNMITQGIDRAPHRSLLRAAGVKEEDFGKPFIAVCNSYIDIVPGHVHLQEFGKIV
CCHHHHHHHHHCCCCCHHHHHHHHCCCCHHHCCCHHHHHHHHHHHHCCCEEEHHHHHHHH
KEAIREAGGVPFEFNTIGVDDGIAMGHIGMRYSLPSREIIADSVETVVSAHWFDGMVCIP
HHHHHHHCCCCEEEEEECCCCCCEECCCCEEECCCCHHHHHHHHHHHHHHHHCCCEEECC
NCDKITPGMLMAAMRINIPTIFVSGGPMAAGRTSDGRKISLSSVFEGVGAYQAGKINENE
CCCCCCHHHHHHHHEECCCEEEECCCCCCCCCCCCCCEEEHHHHHHHCCCCCCCCCCHHH
LQELEQFGCPTCGSCSGMFTANSMNCLSEALGLALPGNGTILATSPERKEFVRKSAAQLM
HHHHHHCCCCCCCCCCCCEECCHHHHHHHHHCEEECCCCEEEECCCHHHHHHHHHHHHHH
ETIRKDIKPRDIVTVKAIDNAFALDMALGGSTNTVLHTLALANEAGVEYSLERINEVAER
HHHHHCCCCCCEEEEEECCCEEEEEEEECCCCHHHHHHHHHHHHCCCHHHHHHHHHHHHH
VPHLAKLAPASDVFIEDLHEAGGVSAALNELSKKEGALHLDALTVTGKTLGETIAGHEVK
CCHHHHHCCCHHHHHHHHHHHCCHHHHHHHHHHHCCCEEEEEEEECCHHHHHHHCCCCCC
DYDVIHPLDQPFTEKGGLAVLFGNLAPDGAIIKTGGVQNGITRHEGPAVVFDSQDEALDG
CCCCCCCCCCCCCCCCCEEEEECCCCCCCCEEECCCCCCCCCCCCCCEEEECCCHHHHHH
IINRKVKEGDVVIIRYEGPKGGPGMPEMLAPTSQIVGMGLGPKVALITDGRFSGASRGLS
HHHCCCCCCCEEEEEECCCCCCCCCCHHHCCHHHHHCCCCCCEEEEEECCCCCCCCCCCE
IGHVSPEAAEGGPLAFVENGDHIIVDIEKRILDVQVPEEEWEKRKANWKGFEPKVKTGYL
ECCCCCCCCCCCCEEEEECCCEEEEEEECCEEEEECCHHHHHHHCCCCCCCCCCCCHHHH
ARYSKLVTSANTGGIMKI
HHHHHHHHCCCCCCEEEC
>Mature Secondary Structure 
AELRSNMITQGIDRAPHRSLLRAAGVKEEDFGKPFIAVCNSYIDIVPGHVHLQEFGKIV
CHHHHHHHHHCCCCCHHHHHHHHCCCCHHHCCCHHHHHHHHHHHHCCCEEEHHHHHHHH
KEAIREAGGVPFEFNTIGVDDGIAMGHIGMRYSLPSREIIADSVETVVSAHWFDGMVCIP
HHHHHHHCCCCEEEEEECCCCCCEECCCCEEECCCCHHHHHHHHHHHHHHHHCCCEEECC
NCDKITPGMLMAAMRINIPTIFVSGGPMAAGRTSDGRKISLSSVFEGVGAYQAGKINENE
CCCCCCHHHHHHHHEECCCEEEECCCCCCCCCCCCCCEEEHHHHHHHCCCCCCCCCCHHH
LQELEQFGCPTCGSCSGMFTANSMNCLSEALGLALPGNGTILATSPERKEFVRKSAAQLM
HHHHHHCCCCCCCCCCCCEECCHHHHHHHHHCEEECCCCEEEECCCHHHHHHHHHHHHHH
ETIRKDIKPRDIVTVKAIDNAFALDMALGGSTNTVLHTLALANEAGVEYSLERINEVAER
HHHHHCCCCCCEEEEEECCCEEEEEEEECCCCHHHHHHHHHHHHCCCHHHHHHHHHHHHH
VPHLAKLAPASDVFIEDLHEAGGVSAALNELSKKEGALHLDALTVTGKTLGETIAGHEVK
CCHHHHHCCCHHHHHHHHHHHCCHHHHHHHHHHHCCCEEEEEEEECCHHHHHHHCCCCCC
DYDVIHPLDQPFTEKGGLAVLFGNLAPDGAIIKTGGVQNGITRHEGPAVVFDSQDEALDG
CCCCCCCCCCCCCCCCCEEEEECCCCCCCCEEECCCCCCCCCCCCCCEEEECCCHHHHHH
IINRKVKEGDVVIIRYEGPKGGPGMPEMLAPTSQIVGMGLGPKVALITDGRFSGASRGLS
HHHCCCCCCCEEEEEECCCCCCCCCCHHHCCHHHHHCCCCCCEEEEEECCCCCCCCCCCE
IGHVSPEAAEGGPLAFVENGDHIIVDIEKRILDVQVPEEEWEKRKANWKGFEPKVKTGYL
ECCCCCCCCCCCCEEEEECCCEEEEEEECCEEEEECCHHHHHHHCCCCCCCCCCCCHHHH
ARYSKLVTSANTGGIMKI
HHHHHHHHCCCCCCEEEC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA