Definition Xanthomonas campestris pv. campestris str. 8004 chromosome, complete genome.
Accession NC_007086
Length 5,148,708

Click here to switch to the map view.

The map label for this gene is ilvG [H]

Identifier: 66767173

GI number: 66767173

Start: 1010234

End: 1011955

Strand: Reverse

Name: ilvG [H]

Synonym: XC_0840

Alternate gene names: 66767173

Gene position: 1011955-1010234 (Counterclockwise)

Preceding gene: 66767174

Following gene: 66767172

Centisome position: 19.65

GC content: 66.55

Gene sequence:

>1722_bases
ATGAACACCTCCGCACACAGCAAGCCCCGCAATGGCGCGCGCTGGCTGACGCAGGCCCTGGAAGCCGAGGGCGTGGAAAC
GCTGTTCGGCTATCCGGGCGGCACCATCATGCCGTTCTACGACGCCCTGGTGGATTCCAAGCTCAAGCACATCCTGGTGC
GTCACGAACAAGGTGCCGCATTGGCGGCCAACGGGTTCGCCCGTGCCAGTGGCCGTGTCGGCGTGTGCGTGGCCACCTCC
GGCCCGGGCGCGTCCAACCTGGTCACCGGCATTGCCGACGCCATGCTCGACTCGGTGCCGATGGTGTGCCTGACCGGCCA
GGTCGCCACGCCGTTGCTGGGCACCGATGCGTTCCAGGAACTGGACGTGTTCGGCATGACCATGCCGATCGTCAAGCACA
GCTTTCTGGTGCGCAGCGTGGATGAGTTGCCGGAGATGGTGCGCGAGGCGTTTCGGATTGCACGCGAAGGGCGTCCCGGG
CCGGTGCTGATCGACCTGCCAAAGGACGTGCAGATTGCCGATGCCTCGCATCTGCCCGACCACGTGCCGGCGCAGGTGCT
GCCTCCGCCGGCGCCGCAGGACGCCAAATTGGCCGAAGCGTTGGCGGCGATCGCCAGCGCCGAACGCCCGGTGGTCTACG
GCGGTGGCGGCATTGCGCTGGCGGGTGCGGTGGAGGCTTTCCGCCGCTTCGTGGAAGCCACCGGCATGCCGACCGCGCTG
ACCTTGCGCGGCCTGGGCGCCTTGCCGCACGCCCATCCGGACTACCTGGGCATGTTGGGCATGCATGGCACGCGCGCGGC
GAACATGGCCATCCAGGAATGCGATCTGCTGGTGGTGGTCGGCGCCCGGTTCGACGACCGCGCCACCGGCAAACTGAGCG
AATTTGCACCATTTGCGCGCGTCATCCACCTGGATGCCGACGCGTATGAAATTTCCAAGCTGCGCACCGCCGATGTGGCG
GTGCCCGGCGATGTAGCCACCAGCCTGAAGGCGTTGAGCGCGGCACGTGCCAATTGCCAGGCCTGGCGCACGCGGTGTTT
TGCCAACCGTGAAAAGTTCGGCGCGCGCTATGACGCACCGGGCACCGATATCTACGCACCGGCACTGCTGAAGCGCCTGA
GCGAAGTGGCCCCGGCCGACACCATCATTGCCTGCGATGTCGGCCAGCATCAGATGTGGGTTGCCCAGCATTGCCGCTTC
AACCACCCACGCAACCATCTCACCAGCGGCGCGCTCGGCACCATGGGCTTCGGCCTGCCGGCGGCGATGGGCGCGCAGTT
CGCCTGCCCGGACCGCACCGTGGTGCTGGTCTCCGGCGATGGCAGCTTCATGATGAATGTGCAGGAACTGGTGACGATTG
CGCGTTGCAAGTTGCCGGTGAAGATCGTGCTGCTGGATAACAGCTCGCTGGGCATGGTGCGGCAGTGGCAGGAACTGTTC
TTCGCCGAGCGCTACAGCGAGATCGACCTCTCCGACAACCCGGATTTCGCCGCATTGGCGCAGGTATTCGGCATCCCGGC
CAAGCGCATCATTGCGCGCGGCGATGTGGACGCCGCGCTGGCCGAGTTGCTGGCGCAGCCCGGCCCGGGCCTGCTGCATG
TGGCCATCGACGCACGCGCCAACGTGTGGCCGCTGGTGCCGCCCAACAACGCCAACAGCACCATGCTGGACAGCAATCCC
GCACATGCGGCCAAGGAGACCCCTCATGCGTTACCGGCTTGA

Upstream 100 bases:

>100_bases
GCTCAATGGTGAGCAGCAGGCCGCCGCTACACCTGCCAAGCAACAGGCGGCGTAACGCCGCCGCCTCCCCCACCGTTTAA
CCGAAAGGTCCGCACAACGC

Downstream 100 bases:

>100_bases
TCTGGTGCTGAAGCCGGCCGAAGGCGCGCTGGTGCGCGTGATCGGCATGACCGAACGGCGTGGCTTCCGCCCGTGCGCCA
TCCAGGGCGCCGCCGCGCCG

Product: acetolactate synthase 2 catalytic subunit

Products: NA

Alternate protein names: AHAS-II; ALS-II; Acetohydroxy-acid synthase II large subunit [H]

Number of amino acids: Translated: 573; Mature: 573

Protein sequence:

>573_residues
MNTSAHSKPRNGARWLTQALEAEGVETLFGYPGGTIMPFYDALVDSKLKHILVRHEQGAALAANGFARASGRVGVCVATS
GPGASNLVTGIADAMLDSVPMVCLTGQVATPLLGTDAFQELDVFGMTMPIVKHSFLVRSVDELPEMVREAFRIAREGRPG
PVLIDLPKDVQIADASHLPDHVPAQVLPPPAPQDAKLAEALAAIASAERPVVYGGGGIALAGAVEAFRRFVEATGMPTAL
TLRGLGALPHAHPDYLGMLGMHGTRAANMAIQECDLLVVVGARFDDRATGKLSEFAPFARVIHLDADAYEISKLRTADVA
VPGDVATSLKALSAARANCQAWRTRCFANREKFGARYDAPGTDIYAPALLKRLSEVAPADTIIACDVGQHQMWVAQHCRF
NHPRNHLTSGALGTMGFGLPAAMGAQFACPDRTVVLVSGDGSFMMNVQELVTIARCKLPVKIVLLDNSSLGMVRQWQELF
FAERYSEIDLSDNPDFAALAQVFGIPAKRIIARGDVDAALAELLAQPGPGLLHVAIDARANVWPLVPPNNANSTMLDSNP
AHAAKETPHALPA

Sequences:

>Translated_573_residues
MNTSAHSKPRNGARWLTQALEAEGVETLFGYPGGTIMPFYDALVDSKLKHILVRHEQGAALAANGFARASGRVGVCVATS
GPGASNLVTGIADAMLDSVPMVCLTGQVATPLLGTDAFQELDVFGMTMPIVKHSFLVRSVDELPEMVREAFRIAREGRPG
PVLIDLPKDVQIADASHLPDHVPAQVLPPPAPQDAKLAEALAAIASAERPVVYGGGGIALAGAVEAFRRFVEATGMPTAL
TLRGLGALPHAHPDYLGMLGMHGTRAANMAIQECDLLVVVGARFDDRATGKLSEFAPFARVIHLDADAYEISKLRTADVA
VPGDVATSLKALSAARANCQAWRTRCFANREKFGARYDAPGTDIYAPALLKRLSEVAPADTIIACDVGQHQMWVAQHCRF
NHPRNHLTSGALGTMGFGLPAAMGAQFACPDRTVVLVSGDGSFMMNVQELVTIARCKLPVKIVLLDNSSLGMVRQWQELF
FAERYSEIDLSDNPDFAALAQVFGIPAKRIIARGDVDAALAELLAQPGPGLLHVAIDARANVWPLVPPNNANSTMLDSNP
AHAAKETPHALPA
>Mature_573_residues
MNTSAHSKPRNGARWLTQALEAEGVETLFGYPGGTIMPFYDALVDSKLKHILVRHEQGAALAANGFARASGRVGVCVATS
GPGASNLVTGIADAMLDSVPMVCLTGQVATPLLGTDAFQELDVFGMTMPIVKHSFLVRSVDELPEMVREAFRIAREGRPG
PVLIDLPKDVQIADASHLPDHVPAQVLPPPAPQDAKLAEALAAIASAERPVVYGGGGIALAGAVEAFRRFVEATGMPTAL
TLRGLGALPHAHPDYLGMLGMHGTRAANMAIQECDLLVVVGARFDDRATGKLSEFAPFARVIHLDADAYEISKLRTADVA
VPGDVATSLKALSAARANCQAWRTRCFANREKFGARYDAPGTDIYAPALLKRLSEVAPADTIIACDVGQHQMWVAQHCRF
NHPRNHLTSGALGTMGFGLPAAMGAQFACPDRTVVLVSGDGSFMMNVQELVTIARCKLPVKIVLLDNSSLGMVRQWQELF
FAERYSEIDLSDNPDFAALAQVFGIPAKRIIARGDVDAALAELLAQPGPGLLHVAIDARANVWPLVPPNNANSTMLDSNP
AHAAKETPHALPA

Specific function: Catalyzes the first step in the biosynthesis of branched-chain amino acids [H]

COG id: COG0028

COG function: function code EH; Thiamine pyrophosphate-requiring enzymes [acetolactate synthase, pyruvate dehydrogenase (cytochrome), glyoxylate carboligase, phosphonopyruvate decarboxylase]

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the TPP enzyme family [H]

Homologues:

Organism=Homo sapiens, GI93004078, Length=562, Percent_Identity=24.7330960854093, Blast_Score=152, Evalue=9e-37,
Organism=Homo sapiens, GI21361361, Length=520, Percent_Identity=26.9230769230769, Blast_Score=142, Evalue=1e-33,
Organism=Escherichia coli, GI1790104, Length=560, Percent_Identity=45.7142857142857, Blast_Score=482, Evalue=1e-137,
Organism=Escherichia coli, GI87081685, Length=553, Percent_Identity=42.49547920434, Blast_Score=446, Evalue=1e-126,
Organism=Escherichia coli, GI1786717, Length=548, Percent_Identity=30.4744525547445, Blast_Score=271, Evalue=8e-74,
Organism=Escherichia coli, GI1787096, Length=539, Percent_Identity=28.7569573283859, Blast_Score=181, Evalue=2e-46,
Organism=Escherichia coli, GI1788716, Length=547, Percent_Identity=26.3254113345521, Blast_Score=143, Evalue=3e-35,
Organism=Caenorhabditis elegans, GI17542570, Length=501, Percent_Identity=29.3413173652695, Blast_Score=158, Evalue=7e-39,
Organism=Caenorhabditis elegans, GI17531301, Length=479, Percent_Identity=28.39248434238, Blast_Score=155, Evalue=6e-38,
Organism=Caenorhabditis elegans, GI17531299, Length=479, Percent_Identity=28.39248434238, Blast_Score=155, Evalue=7e-38,
Organism=Saccharomyces cerevisiae, GI6323755, Length=589, Percent_Identity=41.2563667232598, Blast_Score=423, Evalue=1e-119,
Organism=Saccharomyces cerevisiae, GI6320816, Length=478, Percent_Identity=23.6401673640167, Blast_Score=117, Evalue=5e-27,
Organism=Saccharomyces cerevisiae, GI6323163, Length=482, Percent_Identity=24.2738589211618, Blast_Score=83, Evalue=1e-16,
Organism=Drosophila melanogaster, GI19922626, Length=496, Percent_Identity=28.2258064516129, Blast_Score=173, Evalue=2e-43,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR012846
- InterPro:   IPR012000
- InterPro:   IPR012001
- InterPro:   IPR000399
- InterPro:   IPR011766 [H]

Pfam domain/function: PF02775 TPP_enzyme_C; PF00205 TPP_enzyme_M; PF02776 TPP_enzyme_N [H]

EC number: =2.2.1.6 [H]

Molecular weight: Translated: 60859; Mature: 60859

Theoretical pI: Translated: 6.46; Mature: 6.46

Prosite motif: PS00187 TPP_ENZYMES

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.6 %Cys     (Translated Protein)
3.1 %Met     (Translated Protein)
4.7 %Cys+Met (Translated Protein)
1.6 %Cys     (Mature Protein)
3.1 %Met     (Mature Protein)
4.7 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MNTSAHSKPRNGARWLTQALEAEGVETLFGYPGGTIMPFYDALVDSKLKHILVRHEQGAA
CCCCCCCCCCCHHHHHHHHHHHCCCHHHHCCCCCCHHHHHHHHHHHHHHHHHHCCCCCCE
LAANGFARASGRVGVCVATSGPGASNLVTGIADAMLDSVPMVCLTGQVATPLLGTDAFQE
EEECCCCCCCCCEEEEEEECCCCHHHHHHHHHHHHHHCCCEEEECCCHHCCCCCCHHHHH
LDVFGMTMPIVKHSFLVRSVDELPEMVREAFRIAREGRPGPVLIDLPKDVQIADASHLPD
HHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCEEEECCCCCEECCCCCCCC
HVPAQVLPPPAPQDAKLAEALAAIASAERPVVYGGGGIALAGAVEAFRRFVEATGMPTAL
CCCCCCCCCCCCCCHHHHHHHHHHHCCCCCEEECCCCHHHHHHHHHHHHHHHHCCCCCEE
TLRGLGALPHAHPDYLGMLGMHGTRAANMAIQECDLLVVVGARFDDRATGKLSEFAPFAR
EECCCCCCCCCCCCHHHHHCCCCCHHHHHHHHHCCEEEEECCCCCCCCCCCHHHHCCEEE
VIHLDADAYEISKLRTADVAVPGDVATSLKALSAARANCQAWRTRCFANREKFGARYDAP
EEEECCCHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHCHHHCCCCCCCC
GTDIYAPALLKRLSEVAPADTIIACDVGQHQMWVAQHCRFNHPRNHLTSGALGTMGFGLP
CCCHHHHHHHHHHHHHCCCCEEEEECCCCHHHHHHHHHCCCCCHHHHCCCCCHHHCCCCH
AAMGAQFACPDRTVVLVSGDGSFMMNVQELVTIARCKLPVKIVLLDNSSLGMVRQWQELF
HHHCCCCCCCCCEEEEEECCCCEEECHHHHHHHHHCCCCEEEEEECCCCCHHHHHHHHHH
FAERYSEIDLSDNPDFAALAQVFGIPAKRIIARGDVDAALAELLAQPGPGLLHVAIDARA
HHHHHCCCCCCCCCCHHHHHHHHCCCHHHHHCCCCHHHHHHHHHHCCCCCEEEEEEECCC
NVWPLVPPNNANSTMLDSNPAHAAKETPHALPA
CEECCCCCCCCCCCEECCCCCCHHHCCCCCCCC
>Mature Secondary Structure
MNTSAHSKPRNGARWLTQALEAEGVETLFGYPGGTIMPFYDALVDSKLKHILVRHEQGAA
CCCCCCCCCCCHHHHHHHHHHHCCCHHHHCCCCCCHHHHHHHHHHHHHHHHHHCCCCCCE
LAANGFARASGRVGVCVATSGPGASNLVTGIADAMLDSVPMVCLTGQVATPLLGTDAFQE
EEECCCCCCCCCEEEEEEECCCCHHHHHHHHHHHHHHCCCEEEECCCHHCCCCCCHHHHH
LDVFGMTMPIVKHSFLVRSVDELPEMVREAFRIAREGRPGPVLIDLPKDVQIADASHLPD
HHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCEEEECCCCCEECCCCCCCC
HVPAQVLPPPAPQDAKLAEALAAIASAERPVVYGGGGIALAGAVEAFRRFVEATGMPTAL
CCCCCCCCCCCCCCHHHHHHHHHHHCCCCCEEECCCCHHHHHHHHHHHHHHHHCCCCCEE
TLRGLGALPHAHPDYLGMLGMHGTRAANMAIQECDLLVVVGARFDDRATGKLSEFAPFAR
EECCCCCCCCCCCCHHHHHCCCCCHHHHHHHHHCCEEEEECCCCCCCCCCCHHHHCCEEE
VIHLDADAYEISKLRTADVAVPGDVATSLKALSAARANCQAWRTRCFANREKFGARYDAP
EEEECCCHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHCHHHCCCCCCCC
GTDIYAPALLKRLSEVAPADTIIACDVGQHQMWVAQHCRFNHPRNHLTSGALGTMGFGLP
CCCHHHHHHHHHHHHHCCCCEEEEECCCCHHHHHHHHHCCCCCHHHHCCCCCHHHCCCCH
AAMGAQFACPDRTVVLVSGDGSFMMNVQELVTIARCKLPVKIVLLDNSSLGMVRQWQELF
HHHCCCCCCCCCEEEEEECCCCEEECHHHHHHHHHCCCCEEEEEECCCCCHHHHHHHHHH
FAERYSEIDLSDNPDFAALAQVFGIPAKRIIARGDVDAALAELLAQPGPGLLHVAIDARA
HHHHHCCCCCCCCCCHHHHHHHHCCCHHHHHCCCCHHHHHHHHHHCCCCCEEEEEEECCC
NVWPLVPPNNANSTMLDSNPAHAAKETPHALPA
CEECCCCCCCCCCCEECCCCCCHHHCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 3550695; 1379743; 9278503; 1995430; 6154938; 7015336; 3897211 [H]