Definition Corynebacterium diphtheriae NCTC 13129 chromosome, complete genome.
Accession NC_002935
Length 2,488,635

Click here to switch to the map view.

The map label for this gene is ilvB [H]

Identifier: 38233692

GI number: 38233692

Start: 1082013

End: 1083971

Strand: Direct

Name: ilvB [H]

Synonym: DIP1098

Alternate gene names: 38233692

Gene position: 1082013-1083971 (Clockwise)

Preceding gene: 38233689

Following gene: 38233693

Centisome position: 43.48

GC content: 51.3

Gene sequence:

>1959_bases
ATGTTGCAACATGTCAGTCCCCGCAATTACCACAAGGAGCTTGATGTCGTGGCATCCTCCACTCAGCCCAATCAGCCCAC
ACCAGCGACGTTAGCCCGACGTGCGCAGGTATTAAAGCCGGAGCGAATGACCGGTGCAGACGCAATCGTGCGATCGTTGG
AAGAACTCGGAATCGACATGGTCTTTGGCCTTCCAGGCGGCGCTGTTTTGCCTCTTTATGACTCGTTGTATGCATCGACC
AAATTGCGTCACGTTCTTGTACGTCATGAACAAGGCGCAGGTCATGCCGCAACTGGATATGCACAAGCTACTGGAAAAGT
GGGTGTGTGTATTGCAACGTCGGGTCCAGGTGCAACGAACCTTGTAACGCCTATCGCGGATGCGCACTTGGATTCGGTGC
CACTTGTCGCTATCACCGGACAGGTTGGGCGCTCCCTCTTGGGGTCTGATGCTTTCCAAGAAGCCGATATTCGTGGTATT
ACGATGCCGGTTACTAAGCACAACTTCATGGTTACGGATGTCAACATGATTCCGCAGGCGATCGCAGAGGCATTTTATCT
GGCGGCTTCCGGTCGGCCAGGACCGGTGCTTGTCGACATTCCCAAGGATATTCAGCAGGCTGAGATCGACTTCCATTGGC
CTCCAACTATTGATTTGCCAGGTTATCGTCCGGTGACTACTCCGCATAGTCGACCTGTTGAACAAGCAGCCAAGATGATT
TCACAAGCTCGTAGGCCTGTTCTATATGTCGGTGGTGGCGTTATTAAGGCGAATGCTTCTCAAGAACTTCAAGCATTTGC
TGAACACACTGGAATTCCAGTTGTTACTACTTTGATGGCATTGGGTGCGTTCCCTGGCTCGCATGAGCTCAATATGGGCA
TGCCTGGAATGCACGGAACCGTTCCAGCTGTGGGAGCTTTGCAAAAGAGCGATCTTCTCATCACTATCGGCGCGCGTTTC
GACGATCGTGTCACGGGTGCACTGGCATCATTTGCTCCTGGCGCAAAAGTTATTCACGCTGATATTGATCCTGCGGAAAT
CGGCAAGATCAGAGCAGTTGATGTTCCAATTGTTGGTGACGCTCAAGAAGTTTTGACCGCGTTGCTTAATGTCTACAAAG
ACTTGGATCTGCCACAGCCTCGGCATGAGCGTTGGCTGCGATACCTCAATGGTTTGAAGAGCAATTATCCGCGTGGTTGG
GAAAAGTCTGACGACGGCATGATTGAGCCGCAGGCGGTTATTAGGGCGCTTGCTAAGACGGTTGGTACTGATGCGATTTA
TGCTGCAGGTGTTGGACAGCATCAAATGTGGTCTGCACAGTTCCTTGACTTTGAAAAGCCACGTACGTGGCTCAACTCTG
GTGGCTTGGGCACGATGGGTTATTCGGTTCCCGCAGCCCTAGGTGCTAAGGCTGGTTGCCCAGACAAAGAAGTTTGGGCA
ATCGATGGTGATGGTTGCTTCCAAATGACTAATCAAGAGCTTGCGACGGCAGCTGTGGAGGGCATGCCGATCAAAGTAGC
TCTTATTAATAACGGCAATCTAGGCATGGTGCGCCAGTGGCAAACGCTCTTCTATGACGGTAACTATTCAAATACCAAGC
TCCGCAATCAGGGGCAGTATATGCCGGACTTCGTGATGCTGGCGGAATCTTTGGGCTGTGCAGCTTTCCGTGTGACGGAG
GAGACTGACATCGTTCCGACGATTGAAAAAGCACGAGCGATTAACGACCGCCCCGTGGTGATCGATTTTATTGTTGGTGA
AGATGCACAAGTGTGGCCAATGGTTGCAGCAGGACATTCCAATTCTGACATTGAATATGCTCATGGGCTCCGTCCGCTTT
TCGACGGAGAAAGCTCTGCTGCTGAGACTCCAGAGGATATCGACGATGTTATTGATGAGGCAACGCTTCTCGCACTTGAG
GCGCAAAAACGTCACCTAGAACCTAAAGAAAATATCTAG

Upstream 100 bases:

>100_bases
CACAGGTTATGAGGACTTGGCTGTAGAAAGTAAAACTTGGCTTTCGTACGGCAGGAGTACTAATTCGACCATTGGATAAC
ATCCCGTCGCGGGAGGCCAC

Downstream 100 bases:

>100_bases
AAAAGGAGCACTGTGATGCAACAGCAAGAAACGTTTCGGCACATCCTCAGTGTTCTGGTTCAGGATGTTGATGGCATTAT
CTCTCGTGTATCTGCAATGT

Product: acetolactate synthase 1 catalytic subunit

Products: NA

Alternate protein names: AHAS; Acetohydroxy-acid synthase large subunit; ALS [H]

Number of amino acids: Translated: 652; Mature: 652

Protein sequence:

>652_residues
MLQHVSPRNYHKELDVVASSTQPNQPTPATLARRAQVLKPERMTGADAIVRSLEELGIDMVFGLPGGAVLPLYDSLYAST
KLRHVLVRHEQGAGHAATGYAQATGKVGVCIATSGPGATNLVTPIADAHLDSVPLVAITGQVGRSLLGSDAFQEADIRGI
TMPVTKHNFMVTDVNMIPQAIAEAFYLAASGRPGPVLVDIPKDIQQAEIDFHWPPTIDLPGYRPVTTPHSRPVEQAAKMI
SQARRPVLYVGGGVIKANASQELQAFAEHTGIPVVTTLMALGAFPGSHELNMGMPGMHGTVPAVGALQKSDLLITIGARF
DDRVTGALASFAPGAKVIHADIDPAEIGKIRAVDVPIVGDAQEVLTALLNVYKDLDLPQPRHERWLRYLNGLKSNYPRGW
EKSDDGMIEPQAVIRALAKTVGTDAIYAAGVGQHQMWSAQFLDFEKPRTWLNSGGLGTMGYSVPAALGAKAGCPDKEVWA
IDGDGCFQMTNQELATAAVEGMPIKVALINNGNLGMVRQWQTLFYDGNYSNTKLRNQGQYMPDFVMLAESLGCAAFRVTE
ETDIVPTIEKARAINDRPVVIDFIVGEDAQVWPMVAAGHSNSDIEYAHGLRPLFDGESSAAETPEDIDDVIDEATLLALE
AQKRHLEPKENI

Sequences:

>Translated_652_residues
MLQHVSPRNYHKELDVVASSTQPNQPTPATLARRAQVLKPERMTGADAIVRSLEELGIDMVFGLPGGAVLPLYDSLYAST
KLRHVLVRHEQGAGHAATGYAQATGKVGVCIATSGPGATNLVTPIADAHLDSVPLVAITGQVGRSLLGSDAFQEADIRGI
TMPVTKHNFMVTDVNMIPQAIAEAFYLAASGRPGPVLVDIPKDIQQAEIDFHWPPTIDLPGYRPVTTPHSRPVEQAAKMI
SQARRPVLYVGGGVIKANASQELQAFAEHTGIPVVTTLMALGAFPGSHELNMGMPGMHGTVPAVGALQKSDLLITIGARF
DDRVTGALASFAPGAKVIHADIDPAEIGKIRAVDVPIVGDAQEVLTALLNVYKDLDLPQPRHERWLRYLNGLKSNYPRGW
EKSDDGMIEPQAVIRALAKTVGTDAIYAAGVGQHQMWSAQFLDFEKPRTWLNSGGLGTMGYSVPAALGAKAGCPDKEVWA
IDGDGCFQMTNQELATAAVEGMPIKVALINNGNLGMVRQWQTLFYDGNYSNTKLRNQGQYMPDFVMLAESLGCAAFRVTE
ETDIVPTIEKARAINDRPVVIDFIVGEDAQVWPMVAAGHSNSDIEYAHGLRPLFDGESSAAETPEDIDDVIDEATLLALE
AQKRHLEPKENI
>Mature_652_residues
MLQHVSPRNYHKELDVVASSTQPNQPTPATLARRAQVLKPERMTGADAIVRSLEELGIDMVFGLPGGAVLPLYDSLYAST
KLRHVLVRHEQGAGHAATGYAQATGKVGVCIATSGPGATNLVTPIADAHLDSVPLVAITGQVGRSLLGSDAFQEADIRGI
TMPVTKHNFMVTDVNMIPQAIAEAFYLAASGRPGPVLVDIPKDIQQAEIDFHWPPTIDLPGYRPVTTPHSRPVEQAAKMI
SQARRPVLYVGGGVIKANASQELQAFAEHTGIPVVTTLMALGAFPGSHELNMGMPGMHGTVPAVGALQKSDLLITIGARF
DDRVTGALASFAPGAKVIHADIDPAEIGKIRAVDVPIVGDAQEVLTALLNVYKDLDLPQPRHERWLRYLNGLKSNYPRGW
EKSDDGMIEPQAVIRALAKTVGTDAIYAAGVGQHQMWSAQFLDFEKPRTWLNSGGLGTMGYSVPAALGAKAGCPDKEVWA
IDGDGCFQMTNQELATAAVEGMPIKVALINNGNLGMVRQWQTLFYDGNYSNTKLRNQGQYMPDFVMLAESLGCAAFRVTE
ETDIVPTIEKARAINDRPVVIDFIVGEDAQVWPMVAAGHSNSDIEYAHGLRPLFDGESSAAETPEDIDDVIDEATLLALE
AQKRHLEPKENI

Specific function: Valine and isoleucine biosynthesis; first step. [C]

COG id: COG0028

COG function: function code EH; Thiamine pyrophosphate-requiring enzymes [acetolactate synthase, pyruvate dehydrogenase (cytochrome), glyoxylate carboligase, phosphonopyruvate decarboxylase]

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the TPP enzyme family [H]

Homologues:

Organism=Homo sapiens, GI93004078, Length=575, Percent_Identity=23.6521739130435, Blast_Score=160, Evalue=4e-39,
Organism=Homo sapiens, GI21361361, Length=593, Percent_Identity=25.2951096121417, Blast_Score=133, Evalue=5e-31,
Organism=Escherichia coli, GI87081685, Length=566, Percent_Identity=44.8763250883392, Blast_Score=496, Evalue=1e-141,
Organism=Escherichia coli, GI1790104, Length=566, Percent_Identity=45.0530035335689, Blast_Score=462, Evalue=1e-131,
Organism=Escherichia coli, GI1786717, Length=558, Percent_Identity=39.426523297491, Blast_Score=382, Evalue=1e-107,
Organism=Escherichia coli, GI1787096, Length=566, Percent_Identity=28.0918727915194, Blast_Score=201, Evalue=1e-52,
Organism=Escherichia coli, GI1788716, Length=483, Percent_Identity=27.9503105590062, Blast_Score=159, Evalue=4e-40,
Organism=Caenorhabditis elegans, GI17531301, Length=571, Percent_Identity=26.0945709281961, Blast_Score=143, Evalue=3e-34,
Organism=Caenorhabditis elegans, GI17531299, Length=571, Percent_Identity=26.0945709281961, Blast_Score=142, Evalue=4e-34,
Organism=Caenorhabditis elegans, GI17542570, Length=525, Percent_Identity=25.5238095238095, Blast_Score=134, Evalue=1e-31,
Organism=Saccharomyces cerevisiae, GI6323755, Length=577, Percent_Identity=41.9410745233969, Blast_Score=435, Evalue=1e-122,
Organism=Saccharomyces cerevisiae, GI6320816, Length=502, Percent_Identity=24.3027888446215, Blast_Score=100, Evalue=1e-21,
Organism=Saccharomyces cerevisiae, GI6321524, Length=508, Percent_Identity=22.244094488189, Blast_Score=83, Evalue=2e-16,
Organism=Saccharomyces cerevisiae, GI6323163, Length=507, Percent_Identity=24.0631163708087, Blast_Score=82, Evalue=3e-16,
Organism=Saccharomyces cerevisiae, GI6323073, Length=508, Percent_Identity=22.244094488189, Blast_Score=77, Evalue=7e-15,
Organism=Drosophila melanogaster, GI19922626, Length=561, Percent_Identity=25.4901960784314, Blast_Score=168, Evalue=1e-41,

Paralogues:

None

Copy number: 340 Molecules/Cell In: Growth-Phase, Minimal-Media (Based on E. coli). [C]

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR012846
- InterPro:   IPR012000
- InterPro:   IPR012001
- InterPro:   IPR000399
- InterPro:   IPR011766 [H]

Pfam domain/function: PF02775 TPP_enzyme_C; PF00205 TPP_enzyme_M; PF02776 TPP_enzyme_N [H]

EC number: =2.2.1.6 [H]

Molecular weight: Translated: 70121; Mature: 70121

Theoretical pI: Translated: 5.17; Mature: 5.17

Prosite motif: PS00187 TPP_ENZYMES

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.6 %Cys     (Translated Protein)
3.1 %Met     (Translated Protein)
3.7 %Cys+Met (Translated Protein)
0.6 %Cys     (Mature Protein)
3.1 %Met     (Mature Protein)
3.7 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MLQHVSPRNYHKELDVVASSTQPNQPTPATLARRAQVLKPERMTGADAIVRSLEELGIDM
CCCCCCCCCHHHHHHEEECCCCCCCCCHHHHHHHHHHCCCCCCCCHHHHHHHHHHCCCEE
VFGLPGGAVLPLYDSLYASTKLRHVLVRHEQGAGHAATGYAQATGKVGVCIATSGPGATN
EEECCCCCCHHHHHHHHHHHHHHHHHHEECCCCCCCCCCHHCCCCCEEEEEEECCCCCCC
LVTPIADAHLDSVPLVAITGQVGRSLLGSDAFQEADIRGITMPVTKHNFMVTDVNMIPQA
CCCCHHHCCCCCCCEEEEECHHHHHHHCCCHHHHCCCCEEEEEEECCCEEEEEHHHHHHH
IAEAFYLAASGRPGPVLVDIPKDIQQAEIDFHWPPTIDLPGYRPVTTPHSRPVEQAAKMI
HHHHHEEEECCCCCCEEEECCCCCCCCEEEEECCCCCCCCCCCCCCCCCCCCHHHHHHHH
SQARRPVLYVGGGVIKANASQELQAFAEHTGIPVVTTLMALGAFPGSHELNMGMPGMHGT
HHCCCCEEEECCEEEECCCHHHHHHHHHHCCCHHHHHHHHHHCCCCCCCCCCCCCCCCCC
VPAVGALQKSDLLITIGARFDDRVTGALASFAPGAKVIHADIDPAEIGKIRAVDVPIVGD
CCHHCCCCCCCEEEEECCCCCCHHHHHHHHCCCCCEEEECCCCHHHCCCEEEEECCCCCC
AQEVLTALLNVYKDLDLPQPRHERWLRYLNGLKSNYPRGWEKSDDGMIEPQAVIRALAKT
HHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCHHHHHHHHHHH
VGTDAIYAAGVGQHQMWSAQFLDFEKPRTWLNSGGLGTMGYSVPAALGAKAGCPDKEVWA
HCCCCEEECCCCCHHHHHHHHCCCCCCHHHHCCCCCCCCCCCCHHHHCCCCCCCCCCEEE
IDGDGCFQMTNQELATAAVEGMPIKVALINNGNLGMVRQWQTLFYDGNYSNTKLRNQGQY
ECCCCCEEECCHHHHHHHHCCCEEEEEEEECCCCCEEEEEEEEEECCCCCCCEECCCCCC
MPDFVMLAESLGCAAFRVTEETDIVPTIEKARAINDRPVVIDFIVGEDAQVWPMVAAGHS
CHHHHHHHHHCCCEEEEECCCCCCCCCHHHHHCCCCCCEEEEEEECCCCCEEEEEEECCC
NSDIEYAHGLRPLFDGESSAAETPEDIDDVIDEATLLALEAQKRHLEPKENI
CCCCHHHHCCCCCCCCCCCCCCCHHHHHHHHHHHHHEEEHHHHHCCCCCCCC
>Mature Secondary Structure
MLQHVSPRNYHKELDVVASSTQPNQPTPATLARRAQVLKPERMTGADAIVRSLEELGIDM
CCCCCCCCCHHHHHHEEECCCCCCCCCHHHHHHHHHHCCCCCCCCHHHHHHHHHHCCCEE
VFGLPGGAVLPLYDSLYASTKLRHVLVRHEQGAGHAATGYAQATGKVGVCIATSGPGATN
EEECCCCCCHHHHHHHHHHHHHHHHHHEECCCCCCCCCCHHCCCCCEEEEEEECCCCCCC
LVTPIADAHLDSVPLVAITGQVGRSLLGSDAFQEADIRGITMPVTKHNFMVTDVNMIPQA
CCCCHHHCCCCCCCEEEEECHHHHHHHCCCHHHHCCCCEEEEEEECCCEEEEEHHHHHHH
IAEAFYLAASGRPGPVLVDIPKDIQQAEIDFHWPPTIDLPGYRPVTTPHSRPVEQAAKMI
HHHHHEEEECCCCCCEEEECCCCCCCCEEEEECCCCCCCCCCCCCCCCCCCCHHHHHHHH
SQARRPVLYVGGGVIKANASQELQAFAEHTGIPVVTTLMALGAFPGSHELNMGMPGMHGT
HHCCCCEEEECCEEEECCCHHHHHHHHHHCCCHHHHHHHHHHCCCCCCCCCCCCCCCCCC
VPAVGALQKSDLLITIGARFDDRVTGALASFAPGAKVIHADIDPAEIGKIRAVDVPIVGD
CCHHCCCCCCCEEEEECCCCCCHHHHHHHHCCCCCEEEECCCCHHHCCCEEEEECCCCCC
AQEVLTALLNVYKDLDLPQPRHERWLRYLNGLKSNYPRGWEKSDDGMIEPQAVIRALAKT
HHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCHHHHHHHHHHH
VGTDAIYAAGVGQHQMWSAQFLDFEKPRTWLNSGGLGTMGYSVPAALGAKAGCPDKEVWA
HCCCCEEECCCCCHHHHHHHHCCCCCCHHHHCCCCCCCCCCCCHHHHCCCCCCCCCCEEE
IDGDGCFQMTNQELATAAVEGMPIKVALINNGNLGMVRQWQTLFYDGNYSNTKLRNQGQY
ECCCCCEEECCHHHHHHHHCCCEEEEEEEECCCCCEEEEEEEEEECCCCCCCEECCCCCC
MPDFVMLAESLGCAAFRVTEETDIVPTIEKARAINDRPVVIDFIVGEDAQVWPMVAAGHS
CHHHHHHHHHCCCEEEEECCCCCCCCCHHHHHCCCCCCEEEEEEECCCCCEEEEEEECCC
NSDIEYAHGLRPLFDGESSAAETPEDIDDVIDEATLLALEAQKRHLEPKENI
CCCCHHHHCCCCCCCCCCCCCCCHHHHHHHHHHHHHEEEHHHHHCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 8366043; 12948626 [H]