Definition Burkholderia sp. 383 chromosome 1, complete genome.
Accession NC_007510
Length 3,694,126

Click here to switch to the map view.

The map label for this gene is mutL

Identifier: 78065327

GI number: 78065327

Start: 759905

End: 761890

Strand: Reverse

Name: mutL

Synonym: Bcep18194_A3853

Alternate gene names: 78065327

Gene position: 761890-759905 (Counterclockwise)

Preceding gene: 78065329

Following gene: 78065326

Centisome position: 20.62

GC content: 69.79

Gene sequence:

>1986_bases
ATGTCCGATATCACCGAAACGGCGGCGGGCGCCGCGCCCGCCCCTGCTCCGCGCCCGCTGCGCGCGATCCAGCCCCTGCC
CGACCAGCTGATCAGCCAGATCGCCGCCGGCGAGGTCGTCGAACGCCCGGCGTCGGTCGTCAAGGAGCTGCTCGAGAACG
CGATGGACGCCGGCGCCAGCACGCTGCGCATCGTGCTGGAAGAAGGCGGCGTCAAGCGCATCTCGATCACCGACGACGGC
TGCGGGATTCCGCCGGACGAGCTGGCGCTCGCGCTGATGCGCCACGCGACCAGCAAGATCCGCTCGCTCGAGGAACTCGA
GGCAGTCGCCACGCTCGGGTTCCGCGGCGAAGCGCTGGCGTCGATCGCGTCGGTCGCCGAGATGTCGATCACGAGCCGGA
CGGCCGATGCCGCGCATGCGATGAAGATCGACGCGCAGACGGGCGTGCTGTCCCCCGCCGCCGGCTCGACCGGCACGACG
ATCGAGGTCCGCGAGCTGTACTTCAATACGCCCGCGCGCCGCAAGTTCCTGAAGAGCGAGCAGACCGAGTTCGGACACTG
CCTGGAAATGATCCGCCGCGCAGCGCTCGCGCGGCCGGACGTCGCGATCTCGGTACTGCACAACGGCAAGGCGGTCGAGC
ACTGGAATGCGACCGAGCCCGCGCAGCGCGTCGCGAAAATCCTCGGCGACAGCTTCGCGACCGCGCACCTGCCGCTCGAC
GAGCAGGCCGGCCCGCTTGCGGTCTACGGCTGCGCAGGCCTGCCGACCGCGAGCCGCGGGCGCGCCGACCAGCAATACTT
CTTCGTCAACGGCCGCTTCGTGCGCGACAAGCTGCTGACGCACGCGGTGCGCGCTGCCTATGAGGACGTGCTGCACGGCG
ACCGCTACCCGTCTTACGTGCTGTTCCTCGACCTGCCGCCCGAAGCCGTCGACGTGAACGTGCACCCGTCGAAGATCGAG
GTGCGTTTCCGCGATTCGCGCTCGATCCACCAATATGTTTTCCATGCGGTCCAGCGCGCGCTGGCGCGCCACGCGGGCGC
GTCGCCGGAGACCACGGCGGGCGGCCATGCCGCGCAACTCTCACCGGCGCCGCGCGGGCCCGCTTCGTTTCTGGACACCC
CGCTCGGCCAGAGCCAGCAGGGCAACGCGATCGGCGGCAGCGGCTTCTCGCCGTCGTCGTCGTCATCGTCGGGCAACACC
TGGATGCGCCAGGCGCGGATGACCCAGGGCACGCTGCCCGTCGCGCAGCCGCTCGCGCTCTATGACGCGCTGTTCGGCCG
CAAGGACACGGGCGCGGGCACGCCGGACGGCACGACGACCATCGCCCGCGATTCGGCCGACGCGCCGCTTGCGCCGCTGC
CGGGCTTCCTGGCTTCGCCGATCGCGGCCACTGCTCACGACGAGCAGCCGCTCGGCTTCGCGCTCGGCCAGATCCACGGC
ATCTACGTGCTCGCGCAGAACGCGCACGGCCTCGTGATCGTCGACATGCACGCAGCCCACGAGCGGATCCTGTACGAACA
GTTCAAGAACGCGCTTGCCGACCGCTCGGTCGCCGTGCAGGCGCTGCTGCTGCCGATCTCCATGACGGCCACGCCGGTCG
AGATCGGCACGGTCGAGGAAGAACGCGACACGCTCGAATCGCTCGGCTTCGACCTGGCGGTACTGTCGCCGACGACGCTC
GCGATCCGCGCGGTCCCGGCGTTGCTGAAGGATGCCGACCTGCAGTCGCTCGCGCGCGCGGTGCTCGCCGATCTTCACGC
GTTCGGCGGCTCTCGCGTGCTCACCGAGCGTCAGCACGAACTGCTCGGTACGCTCGCCTGCCATCACGCGGTACGTGCGA
ACCGGCGCCTGACGCTCGACGAGATGAATGCACTGCTGCGGCAGATGGAGGCGACCGAACGCGCGGACCAGTGCAATCAC
GGCCGGCCGACGTGGTATCAGCTCACGCTGAACGATCTCGACCGCCTCTTCATGCGCGGCCAATGA

Upstream 100 bases:

>100_bases
TGTAACGAACCCATGATACCGAAACTACCTTAAGGCTCCGTGAAAAAACGTAACCGCCGGTCGCCCCGGCACGCATTCAC
CGCCTCGCTATAATTCGGCC

Downstream 100 bases:

>100_bases
GCGCGGCACCGCACGCCAGCCCGACGACGATCGCCTGCCTGCTCGGCCCCACCGCATCGGGCAAGACGGCCGCGGCGCTG
GCGCTCGCCGCGCGCCGCCC

Product: DNA mismatch repair protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 661; Mature: 660

Protein sequence:

>661_residues
MSDITETAAGAAPAPAPRPLRAIQPLPDQLISQIAAGEVVERPASVVKELLENAMDAGASTLRIVLEEGGVKRISITDDG
CGIPPDELALALMRHATSKIRSLEELEAVATLGFRGEALASIASVAEMSITSRTADAAHAMKIDAQTGVLSPAAGSTGTT
IEVRELYFNTPARRKFLKSEQTEFGHCLEMIRRAALARPDVAISVLHNGKAVEHWNATEPAQRVAKILGDSFATAHLPLD
EQAGPLAVYGCAGLPTASRGRADQQYFFVNGRFVRDKLLTHAVRAAYEDVLHGDRYPSYVLFLDLPPEAVDVNVHPSKIE
VRFRDSRSIHQYVFHAVQRALARHAGASPETTAGGHAAQLSPAPRGPASFLDTPLGQSQQGNAIGGSGFSPSSSSSSGNT
WMRQARMTQGTLPVAQPLALYDALFGRKDTGAGTPDGTTTIARDSADAPLAPLPGFLASPIAATAHDEQPLGFALGQIHG
IYVLAQNAHGLVIVDMHAAHERILYEQFKNALADRSVAVQALLLPISMTATPVEIGTVEEERDTLESLGFDLAVLSPTTL
AIRAVPALLKDADLQSLARAVLADLHAFGGSRVLTERQHELLGTLACHHAVRANRRLTLDEMNALLRQMEATERADQCNH
GRPTWYQLTLNDLDRLFMRGQ

Sequences:

>Translated_661_residues
MSDITETAAGAAPAPAPRPLRAIQPLPDQLISQIAAGEVVERPASVVKELLENAMDAGASTLRIVLEEGGVKRISITDDG
CGIPPDELALALMRHATSKIRSLEELEAVATLGFRGEALASIASVAEMSITSRTADAAHAMKIDAQTGVLSPAAGSTGTT
IEVRELYFNTPARRKFLKSEQTEFGHCLEMIRRAALARPDVAISVLHNGKAVEHWNATEPAQRVAKILGDSFATAHLPLD
EQAGPLAVYGCAGLPTASRGRADQQYFFVNGRFVRDKLLTHAVRAAYEDVLHGDRYPSYVLFLDLPPEAVDVNVHPSKIE
VRFRDSRSIHQYVFHAVQRALARHAGASPETTAGGHAAQLSPAPRGPASFLDTPLGQSQQGNAIGGSGFSPSSSSSSGNT
WMRQARMTQGTLPVAQPLALYDALFGRKDTGAGTPDGTTTIARDSADAPLAPLPGFLASPIAATAHDEQPLGFALGQIHG
IYVLAQNAHGLVIVDMHAAHERILYEQFKNALADRSVAVQALLLPISMTATPVEIGTVEEERDTLESLGFDLAVLSPTTL
AIRAVPALLKDADLQSLARAVLADLHAFGGSRVLTERQHELLGTLACHHAVRANRRLTLDEMNALLRQMEATERADQCNH
GRPTWYQLTLNDLDRLFMRGQ
>Mature_660_residues
SDITETAAGAAPAPAPRPLRAIQPLPDQLISQIAAGEVVERPASVVKELLENAMDAGASTLRIVLEEGGVKRISITDDGC
GIPPDELALALMRHATSKIRSLEELEAVATLGFRGEALASIASVAEMSITSRTADAAHAMKIDAQTGVLSPAAGSTGTTI
EVRELYFNTPARRKFLKSEQTEFGHCLEMIRRAALARPDVAISVLHNGKAVEHWNATEPAQRVAKILGDSFATAHLPLDE
QAGPLAVYGCAGLPTASRGRADQQYFFVNGRFVRDKLLTHAVRAAYEDVLHGDRYPSYVLFLDLPPEAVDVNVHPSKIEV
RFRDSRSIHQYVFHAVQRALARHAGASPETTAGGHAAQLSPAPRGPASFLDTPLGQSQQGNAIGGSGFSPSSSSSSGNTW
MRQARMTQGTLPVAQPLALYDALFGRKDTGAGTPDGTTTIARDSADAPLAPLPGFLASPIAATAHDEQPLGFALGQIHGI
YVLAQNAHGLVIVDMHAAHERILYEQFKNALADRSVAVQALLLPISMTATPVEIGTVEEERDTLESLGFDLAVLSPTTLA
IRAVPALLKDADLQSLARAVLADLHAFGGSRVLTERQHELLGTLACHHAVRANRRLTLDEMNALLRQMEATERADQCNHG
RPTWYQLTLNDLDRLFMRGQ

Specific function: This protein is involved in the repair of mismatches in DNA. It is required for dam-dependent methyl-directed DNA mismatch repair. May act as a "molecular matchmaker", a protein that promotes the formation of a stable complex between two or more DNA-bindi

COG id: COG0323

COG function: function code L; DNA mismatch repair enzyme (predicted ATPase)

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the DNA mismatch repair mutL/hexB family [H]

Homologues:

Organism=Homo sapiens, GI4557757, Length=329, Percent_Identity=34.6504559270517, Blast_Score=198, Evalue=1e-50,
Organism=Homo sapiens, GI4505911, Length=351, Percent_Identity=28.2051282051282, Blast_Score=144, Evalue=3e-34,
Organism=Homo sapiens, GI189458898, Length=351, Percent_Identity=28.2051282051282, Blast_Score=144, Evalue=4e-34,
Organism=Homo sapiens, GI189458896, Length=341, Percent_Identity=29.3255131964809, Blast_Score=135, Evalue=1e-31,
Organism=Homo sapiens, GI4505913, Length=351, Percent_Identity=26.2108262108262, Blast_Score=132, Evalue=7e-31,
Organism=Homo sapiens, GI310128478, Length=351, Percent_Identity=26.2108262108262, Blast_Score=132, Evalue=8e-31,
Organism=Homo sapiens, GI263191589, Length=234, Percent_Identity=31.6239316239316, Blast_Score=105, Evalue=2e-22,
Organism=Homo sapiens, GI310128480, Length=304, Percent_Identity=24.3421052631579, Blast_Score=93, Evalue=7e-19,
Organism=Homo sapiens, GI91992160, Length=271, Percent_Identity=27.3062730627306, Blast_Score=77, Evalue=5e-14,
Organism=Homo sapiens, GI91992162, Length=271, Percent_Identity=27.3062730627306, Blast_Score=77, Evalue=6e-14,
Organism=Escherichia coli, GI1790612, Length=581, Percent_Identity=39.0705679862306, Blast_Score=335, Evalue=6e-93,
Organism=Caenorhabditis elegans, GI71991825, Length=320, Percent_Identity=34.6875, Blast_Score=168, Evalue=7e-42,
Organism=Caenorhabditis elegans, GI17562796, Length=364, Percent_Identity=25.8241758241758, Blast_Score=133, Evalue=3e-31,
Organism=Saccharomyces cerevisiae, GI6323819, Length=403, Percent_Identity=30.0248138957816, Blast_Score=182, Evalue=1e-46,
Organism=Saccharomyces cerevisiae, GI6324247, Length=367, Percent_Identity=26.158038147139, Blast_Score=129, Evalue=2e-30,
Organism=Saccharomyces cerevisiae, GI6325093, Length=699, Percent_Identity=20.7439198855508, Blast_Score=104, Evalue=4e-23,
Organism=Saccharomyces cerevisiae, GI6323063, Length=395, Percent_Identity=22.7848101265823, Blast_Score=78, Evalue=5e-15,
Organism=Drosophila melanogaster, GI17136968, Length=313, Percent_Identity=34.5047923322684, Blast_Score=178, Evalue=1e-44,
Organism=Drosophila melanogaster, GI17136970, Length=356, Percent_Identity=26.123595505618, Blast_Score=102, Evalue=8e-22,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR003594
- InterPro:   IPR002099
- InterPro:   IPR013507
- InterPro:   IPR014762
- InterPro:   IPR020667
- InterPro:   IPR014763
- InterPro:   IPR014790
- InterPro:   IPR020568
- InterPro:   IPR014721 [H]

Pfam domain/function: PF01119 DNA_mis_repair; PF02518 HATPase_c; PF08676 MutL_C [H]

EC number: NA

Molecular weight: Translated: 70778; Mature: 70647

Theoretical pI: Translated: 6.33; Mature: 6.33

Prosite motif: PS00058 DNA_MISMATCH_REPAIR_1

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.8 %Cys     (Translated Protein)
2.0 %Met     (Translated Protein)
2.7 %Cys+Met (Translated Protein)
0.8 %Cys     (Mature Protein)
1.8 %Met     (Mature Protein)
2.6 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSDITETAAGAAPAPAPRPLRAIQPLPDQLISQIAAGEVVERPASVVKELLENAMDAGAS
CCCHHHHHCCCCCCCCCCCHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCC
TLRIVLEEGGVKRISITDDGCGIPPDELALALMRHATSKIRSLEELEAVATLGFRGEALA
EEEEEEECCCEEEEEECCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHH
SIASVAEMSITSRTADAAHAMKIDAQTGVLSPAAGSTGTTIEVRELYFNTPARRKFLKSE
HHHHHHHHHHHHHCCHHHHHEEEECCCCCCCCCCCCCCCEEEEHHHHHCCHHHHHHHHHH
QTEFGHCLEMIRRAALARPDVAISVLHNGKAVEHWNATEPAQRVAKILGDSFATAHLPLD
HHHHHHHHHHHHHHHHCCCCEEEEEEECCCEEECCCCCCHHHHHHHHHCCCCCEEECCCC
EQAGPLAVYGCAGLPTASRGRADQQYFFVNGRFVRDKLLTHAVRAAYEDVLHGDRYPSYV
CCCCCEEEEECCCCCCCCCCCCCCEEEEECCCHHHHHHHHHHHHHHHHHHHCCCCCCCEE
LFLDLPPEAVDVNVHPSKIEVRFRDSRSIHQYVFHAVQRALARHAGASPETTAGGHAAQL
EEEECCCCEEEEEECCCEEEEEECCCCHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCEEC
SPAPRGPASFLDTPLGQSQQGNAIGGSGFSPSSSSSSGNTWMRQARMTQGTLPVAQPLAL
CCCCCCCHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHCCCCCCHHHHHHH
YDALFGRKDTGAGTPDGTTTIARDSADAPLAPLPGFLASPIAATAHDEQPLGFALGQIHG
HHHHHCCCCCCCCCCCCCCEEECCCCCCCCCCCCHHHHCCCHHCCCCCCCCHHHHHHHCE
IYVLAQNAHGLVIVDMHAAHERILYEQFKNALADRSVAVQALLLPISMTATPVEIGTVEE
EEEEEECCCCEEEEECHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCEEECCCHH
ERDTLESLGFDLAVLSPTTLAIRAVPALLKDADLQSLARAVLADLHAFGGSRVLTERQHE
HHHHHHHCCCCEEEECCHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHCCCCCHHHHHHHH
LLGTLACHHAVRANRRLTLDEMNALLRQMEATERADQCNHGRPTWYQLTLNDLDRLFMRG
HHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHCCCCCCEEEEEEHHHHHHHHHCC
Q
C
>Mature Secondary Structure 
SDITETAAGAAPAPAPRPLRAIQPLPDQLISQIAAGEVVERPASVVKELLENAMDAGAS
CCHHHHHCCCCCCCCCCCHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCC
TLRIVLEEGGVKRISITDDGCGIPPDELALALMRHATSKIRSLEELEAVATLGFRGEALA
EEEEEEECCCEEEEEECCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHH
SIASVAEMSITSRTADAAHAMKIDAQTGVLSPAAGSTGTTIEVRELYFNTPARRKFLKSE
HHHHHHHHHHHHHCCHHHHHEEEECCCCCCCCCCCCCCCEEEEHHHHHCCHHHHHHHHHH
QTEFGHCLEMIRRAALARPDVAISVLHNGKAVEHWNATEPAQRVAKILGDSFATAHLPLD
HHHHHHHHHHHHHHHHCCCCEEEEEEECCCEEECCCCCCHHHHHHHHHCCCCCEEECCCC
EQAGPLAVYGCAGLPTASRGRADQQYFFVNGRFVRDKLLTHAVRAAYEDVLHGDRYPSYV
CCCCCEEEEECCCCCCCCCCCCCCEEEEECCCHHHHHHHHHHHHHHHHHHHCCCCCCCEE
LFLDLPPEAVDVNVHPSKIEVRFRDSRSIHQYVFHAVQRALARHAGASPETTAGGHAAQL
EEEECCCCEEEEEECCCEEEEEECCCCHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCEEC
SPAPRGPASFLDTPLGQSQQGNAIGGSGFSPSSSSSSGNTWMRQARMTQGTLPVAQPLAL
CCCCCCCHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHCCCCCCHHHHHHH
YDALFGRKDTGAGTPDGTTTIARDSADAPLAPLPGFLASPIAATAHDEQPLGFALGQIHG
HHHHHCCCCCCCCCCCCCCEEECCCCCCCCCCCCHHHHCCCHHCCCCCCCCHHHHHHHCE
IYVLAQNAHGLVIVDMHAAHERILYEQFKNALADRSVAVQALLLPISMTATPVEIGTVEE
EEEEEECCCCEEEEECHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCEEECCCHH
ERDTLESLGFDLAVLSPTTLAIRAVPALLKDADLQSLARAVLADLHAFGGSRVLTERQHE
HHHHHHHCCCCEEEECCHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHCCCCCHHHHHHHH
LLGTLACHHAVRANRRLTLDEMNALLRQMEATERADQCNHGRPTWYQLTLNDLDRLFMRG
HHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHCCCCCCEEEEEEHHHHHHHHHCC
Q
C

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 11823852 [H]