Definition Hyperthermus butylicus DSM 5456 chromosome, complete genome.
Accession NC_008818
Length 1,667,163

Click here to switch to the map view.

The map label for this gene is lig

Identifier: 124027312

GI number: 124027312

Start: 410095

End: 411921

Strand: Reverse

Name: lig

Synonym: Hbut_0421

Alternate gene names: 124027312

Gene position: 411921-410095 (Counterclockwise)

Preceding gene: 124027313

Following gene: 124027309

Centisome position: 24.71

GC content: 52.55

Gene sequence:

>1827_bases
ATGTCTATGCCCTTCTCAGTGCTTGCGGAAACCTTCGAGAAGCTTGAAAGGGTTACAGCTAGAACCCAAATGCTACTATA
TCTTGTAGAACTCTTCAAGAAGACGCCGCCAGAGATTATAGACAAGGTTGTCTACTTCATCCAGGGCAAGCTGTGGCCCG
ACTGGAAGGGCCTACCAGAGCTTGGCATTGGCGAGAAGATGTTGATAAAGGCGGCCTCCATAGCCCTCCACGTATCCGAG
AAGCAGATAGAGCAGCTTGTAAAGAAGCTGGGGGACACCGGTAAGGCTATTGAGATGATTAAACGGGAGAAGCAGCAAAA
GCAGAAGGCAGTGGGCCTCCTAGCCTTCATGCAGAAGCCCTCTGGCGGCGAGAGCACGCTAACTGTGGAGAAGGTGTACG
ACACTCTTGCAAGAATAGCGCTGGTTCAGGGTGAGGGTAGCAGAGATATCAAGCTCAAGCTGCTGGCGGGTCTCCTCGCG
GAGGCTAGTCCGCGCGAGGCAAAGTACATTGCAAGATTTGTTGAGGGACGGTTAAGGCTTGGTGTGGGCGACGCCACCAT
TATGGAGGCTTTAGCAGTAGTCTACGGCGGCAGTGCGGCGATGAGGAGTGTTGTTGAGAGGGCTTACAATCTCCGGGCAG
ACCTAGGCATGGTGGCTAAGATACTTGCAACACAAGGTATAGACGCTCTCAAGAACATAAAGCCGGAGGTGGGAGTCCCG
ATAAGGCCAATGCTCGCAGAGAGGCTCAACGATCCTGTCGAGATAATAAAGAAGCTCGGCGGCCGTGCCCTAGTAGAGTA
CAAGTATGACGGTGAAAGGGCGCAAATACACAAGAAAGGCGATAAGATATGGATATTCTCCCGTCGTCTCGAAAACATAA
CCCACATGTACCCAGATGTTGTTGAGATGGCTAAGAAGGGGATAAAGGCTGAGGAAGCTATCGTAGAGGGCGAGATAGTA
GCGATTGACCCAGAGACTGGTGAGTTCCGGCCATTCCAGGTCCTCATGCACCGCAGGAGGAAGAAAGATGTACATGCAGT
CCTCTCTGAGATACCTGTAGCAGTATTCCTCTTTGACACGCTATACGTTAACGGCGAAGACCTAACCTTGAAGCCCCTAC
CAGCACGCCACGAGGTCCTCGAAAAGATCATAGAGCAGAGTGACACCTGGAGAATCGCCGAGGGCATAGTAACTAGCGAT
CCCCAGGAGCTGGAGAGCTTCTTCCTCAAGGCAATCGAGGATGGTGCTGAAGGTGTAATGGCGAAGGCGATTCATGATCG
TAGCATCTACCAGGCAGGCGCCAGGGGCTGGCTATGGATCAAGTATAAGAGGGACTACAAGTCCGAGATGAGCGACACGG
TAGACCTAGTAGTCATAGGTGCATTCTACGGCAAGGGTAGACGCGGCGGCAAGTTCGGAGCACTGCTCATGGCGGCCTAT
GACCCCGACACAGACACGTTCAAGAGCGTATGCAAGGTTGGCAGCGGCTTCACAGACGAGGACCTCGAACGTCTAGACGA
TATGCTGAAACCCTACATCAGCGACAAGAAACCAGCAAGAGTTGATAGCCAAATGAAGCCGGACGTGTGGGTGGAGCCTA
CGCTCGTGGCAGAGATCATTGGTGCAGAGCTAACGTTAAGCCCCATACATACATGCTGTTATGGCTGGGTCAAGTCTGGT
GCGGGTATATCAATAAGATTCCCGCGCTTCATAAGGTGGAGGCCTGACAAAGGCCCCGAGGATGCTACCACTACAAAGGA
GCTTTACGAGATGTATAAGAGACAGCTGAGAAGGATAAAGGAGGAGGAGGCACCAACCGGAGTCTAG

Upstream 100 bases:

>100_bases
GTTTACCGGTACCGGCTTGGCTAGGCTGCAGGGCCCGGTTTTGCCTCCACGCTAATTAGCGGGTTTACCCGGAATTTATT
CTAACTCGGGATGGTAGAGC

Downstream 100 bases:

>100_bases
CTACGAGAAAGCTAGCACTACGGCCTTGCACGGCTAGTCATCTTCGGTATTTTCAGGTTACACATTGTAAGCCCTAGGCT
AAATTAAGCCTCCTTAGCTA

Product: ATP-dependent DNA ligase

Products: NA

Alternate protein names: Polydeoxyribonucleotide synthase [ATP]

Number of amino acids: Translated: 608; Mature: 607

Protein sequence:

>608_residues
MSMPFSVLAETFEKLERVTARTQMLLYLVELFKKTPPEIIDKVVYFIQGKLWPDWKGLPELGIGEKMLIKAASIALHVSE
KQIEQLVKKLGDTGKAIEMIKREKQQKQKAVGLLAFMQKPSGGESTLTVEKVYDTLARIALVQGEGSRDIKLKLLAGLLA
EASPREAKYIARFVEGRLRLGVGDATIMEALAVVYGGSAAMRSVVERAYNLRADLGMVAKILATQGIDALKNIKPEVGVP
IRPMLAERLNDPVEIIKKLGGRALVEYKYDGERAQIHKKGDKIWIFSRRLENITHMYPDVVEMAKKGIKAEEAIVEGEIV
AIDPETGEFRPFQVLMHRRRKKDVHAVLSEIPVAVFLFDTLYVNGEDLTLKPLPARHEVLEKIIEQSDTWRIAEGIVTSD
PQELESFFLKAIEDGAEGVMAKAIHDRSIYQAGARGWLWIKYKRDYKSEMSDTVDLVVIGAFYGKGRRGGKFGALLMAAY
DPDTDTFKSVCKVGSGFTDEDLERLDDMLKPYISDKKPARVDSQMKPDVWVEPTLVAEIIGAELTLSPIHTCCYGWVKSG
AGISIRFPRFIRWRPDKGPEDATTTKELYEMYKRQLRRIKEEEAPTGV

Sequences:

>Translated_608_residues
MSMPFSVLAETFEKLERVTARTQMLLYLVELFKKTPPEIIDKVVYFIQGKLWPDWKGLPELGIGEKMLIKAASIALHVSE
KQIEQLVKKLGDTGKAIEMIKREKQQKQKAVGLLAFMQKPSGGESTLTVEKVYDTLARIALVQGEGSRDIKLKLLAGLLA
EASPREAKYIARFVEGRLRLGVGDATIMEALAVVYGGSAAMRSVVERAYNLRADLGMVAKILATQGIDALKNIKPEVGVP
IRPMLAERLNDPVEIIKKLGGRALVEYKYDGERAQIHKKGDKIWIFSRRLENITHMYPDVVEMAKKGIKAEEAIVEGEIV
AIDPETGEFRPFQVLMHRRRKKDVHAVLSEIPVAVFLFDTLYVNGEDLTLKPLPARHEVLEKIIEQSDTWRIAEGIVTSD
PQELESFFLKAIEDGAEGVMAKAIHDRSIYQAGARGWLWIKYKRDYKSEMSDTVDLVVIGAFYGKGRRGGKFGALLMAAY
DPDTDTFKSVCKVGSGFTDEDLERLDDMLKPYISDKKPARVDSQMKPDVWVEPTLVAEIIGAELTLSPIHTCCYGWVKSG
AGISIRFPRFIRWRPDKGPEDATTTKELYEMYKRQLRRIKEEEAPTGV
>Mature_607_residues
SMPFSVLAETFEKLERVTARTQMLLYLVELFKKTPPEIIDKVVYFIQGKLWPDWKGLPELGIGEKMLIKAASIALHVSEK
QIEQLVKKLGDTGKAIEMIKREKQQKQKAVGLLAFMQKPSGGESTLTVEKVYDTLARIALVQGEGSRDIKLKLLAGLLAE
ASPREAKYIARFVEGRLRLGVGDATIMEALAVVYGGSAAMRSVVERAYNLRADLGMVAKILATQGIDALKNIKPEVGVPI
RPMLAERLNDPVEIIKKLGGRALVEYKYDGERAQIHKKGDKIWIFSRRLENITHMYPDVVEMAKKGIKAEEAIVEGEIVA
IDPETGEFRPFQVLMHRRRKKDVHAVLSEIPVAVFLFDTLYVNGEDLTLKPLPARHEVLEKIIEQSDTWRIAEGIVTSDP
QELESFFLKAIEDGAEGVMAKAIHDRSIYQAGARGWLWIKYKRDYKSEMSDTVDLVVIGAFYGKGRRGGKFGALLMAAYD
PDTDTFKSVCKVGSGFTDEDLERLDDMLKPYISDKKPARVDSQMKPDVWVEPTLVAEIIGAELTLSPIHTCCYGWVKSGA
GISIRFPRFIRWRPDKGPEDATTTKELYEMYKRQLRRIKEEEAPTGV

Specific function: DNA ligase that seals nicks in double-stranded DNA during DNA replication, DNA recombination and DNA repair

COG id: COG1793

COG function: function code L; ATP-dependent DNA ligase

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Belongs to the ATP-dependent DNA ligase family

Homologues:

Organism=Homo sapiens, GI4557719, Length=636, Percent_Identity=34.1194968553459, Blast_Score=344, Evalue=2e-94,
Organism=Homo sapiens, GI73747829, Length=543, Percent_Identity=29.6500920810313, Blast_Score=207, Evalue=3e-53,
Organism=Homo sapiens, GI73747844, Length=543, Percent_Identity=29.6500920810313, Blast_Score=206, Evalue=5e-53,
Organism=Homo sapiens, GI46255052, Length=631, Percent_Identity=26.148969889065, Blast_Score=157, Evalue=2e-38,
Organism=Homo sapiens, GI23199993, Length=631, Percent_Identity=26.148969889065, Blast_Score=157, Evalue=2e-38,
Organism=Homo sapiens, GI148539894, Length=631, Percent_Identity=26.148969889065, Blast_Score=157, Evalue=2e-38,
Organism=Caenorhabditis elegans, GI71985269, Length=620, Percent_Identity=35.3225806451613, Blast_Score=357, Evalue=1e-98,
Organism=Caenorhabditis elegans, GI71981465, Length=286, Percent_Identity=27.972027972028, Blast_Score=77, Evalue=3e-14,
Organism=Caenorhabditis elegans, GI71985278, Length=196, Percent_Identity=26.530612244898, Blast_Score=75, Evalue=1e-13,
Organism=Saccharomyces cerevisiae, GI6320038, Length=626, Percent_Identity=33.7060702875399, Blast_Score=313, Evalue=7e-86,
Organism=Saccharomyces cerevisiae, GI6324578, Length=406, Percent_Identity=25.3694581280788, Blast_Score=91, Evalue=5e-19,
Organism=Drosophila melanogaster, GI24762424, Length=624, Percent_Identity=33.974358974359, Blast_Score=332, Evalue=4e-91,
Organism=Drosophila melanogaster, GI85815841, Length=559, Percent_Identity=28.8014311270125, Blast_Score=177, Evalue=1e-44,
Organism=Drosophila melanogaster, GI24641829, Length=566, Percent_Identity=26.1484098939929, Blast_Score=108, Evalue=1e-23,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): DNLI_HYPBU (A2BJX6)

Other databases:

- EMBL:   CP000493
- RefSeq:   YP_001012632.1
- ProteinModelPortal:   A2BJX6
- SMR:   A2BJX6
- STRING:   A2BJX6
- GeneID:   4781994
- GenomeReviews:   CP000493_GR
- KEGG:   hbu:Hbut_0421
- eggNOG:   arNOG04596
- HOGENOM:   HBG570821
- OMA:   EYQSICK
- PhylomeDB:   A2BJX6
- ProtClustDB:   PRK01109
- BioCyc:   HBUT415426:HBUT_0421-MONOMER
- HAMAP:   MF_00407
- InterPro:   IPR022865
- InterPro:   IPR000977
- InterPro:   IPR012309
- InterPro:   IPR012310
- InterPro:   IPR016059
- InterPro:   IPR012308
- InterPro:   IPR012340
- InterPro:   IPR016027
- Gene3D:   G3DSA:2.40.50.140
- TIGRFAMs:   TIGR00574

Pfam domain/function: PF04679 DNA_ligase_A_C; PF01068 DNA_ligase_A_M; PF04675 DNA_ligase_A_N; SSF50249 Nucleic_acid_OB

EC number: =6.5.1.1

Molecular weight: Translated: 68330; Mature: 68199

Theoretical pI: Translated: 8.79; Mature: 8.79

Prosite motif: PS00697 DNA_LIGASE_A1; PS00333 DNA_LIGASE_A2; PS50160 DNA_LIGASE_A3

Important sites: ACT_SITE 268-268 BINDING 266-266 BINDING 273-273 BINDING 288-288 BINDING 318-318 BINDING 358-358 BINDING 435-435 BINDING 441-441

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.5 %Cys     (Translated Protein)
3.1 %Met     (Translated Protein)
3.6 %Cys+Met (Translated Protein)
0.5 %Cys     (Mature Protein)
3.0 %Met     (Mature Protein)
3.5 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSMPFSVLAETFEKLERVTARTQMLLYLVELFKKTPPEIIDKVVYFIQGKLWPDWKGLPE
CCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHCCCCCCCCCCCC
LGIGEKMLIKAASIALHVSEKQIEQLVKKLGDTGKAIEMIKREKQQKQKAVGLLAFMQKP
CCCCHHHHHHHHHHHEECCHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHCCC
SGGESTLTVEKVYDTLARIALVQGEGSRDIKLKLLAGLLAEASPREAKYIARFVEGRLRL
CCCCCCEEHHHHHHHHHHHHHEECCCCCCHHHHHHHHHHHCCCCHHHHHHHHHHHCHHEE
GVGDATIMEALAVVYGGSAAMRSVVERAYNLRADLGMVAKILATQGIDALKNIKPEVGVP
CCCHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHCCCCCCCCC
IRPMLAERLNDPVEIIKKLGGRALVEYKYDGERAQIHKKGDKIWIFSRRLENITHMYPDV
CCHHHHHHCCCHHHHHHHCCCCEEEEEEECCCHHHHHHCCCEEEEEHHHHHHHHHHCHHH
VEMAKKGIKAEEAIVEGEIVAIDPETGEFRPFQVLMHRRRKKDVHAVLSEIPVAVFLFDT
HHHHHCCCCHHHHHCCCEEEEECCCCCCCCHHHHHHHHHHHHHHHHHHHHCCHHHHHHHH
LYVNGEDLTLKPLPARHEVLEKIIEQSDTWRIAEGIVTSDPQELESFFLKAIEDGAEGVM
HEECCCCCEECCCCHHHHHHHHHHCCCCCEEHHCCCCCCCHHHHHHHHHHHHHHHHHHHH
AKAIHDRSIYQAGARGWLWIKYKRDYKSEMSDTVDLVVIGAFYGKGRRGGKFGALLMAAY
HHHHHHHHHHHCCCCCEEEEEECCHHHHHHHCCCCEEEEEEHHCCCCCCCCHHEEEEEEE
DPDTDTFKSVCKVGSGFTDEDLERLDDMLKPYISDKKPARVDSQMKPDVWVEPTLVAEII
CCCHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCHHHHHHHH
GAELTLSPIHTCCYGWVKSGAGISIRFPRFIRWRPDKGPEDATTTKELYEMYKRQLRRIK
CCCCCHHHHHHHHHHHHHCCCCEEEECCCCEEECCCCCCCCCHHHHHHHHHHHHHHHHHH
EEEAPTGV
HHCCCCCC
>Mature Secondary Structure 
SMPFSVLAETFEKLERVTARTQMLLYLVELFKKTPPEIIDKVVYFIQGKLWPDWKGLPE
CCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHCCCCCCCCCCCC
LGIGEKMLIKAASIALHVSEKQIEQLVKKLGDTGKAIEMIKREKQQKQKAVGLLAFMQKP
CCCCHHHHHHHHHHHEECCHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHCCC
SGGESTLTVEKVYDTLARIALVQGEGSRDIKLKLLAGLLAEASPREAKYIARFVEGRLRL
CCCCCCEEHHHHHHHHHHHHHEECCCCCCHHHHHHHHHHHCCCCHHHHHHHHHHHCHHEE
GVGDATIMEALAVVYGGSAAMRSVVERAYNLRADLGMVAKILATQGIDALKNIKPEVGVP
CCCHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHCCCCCCCCC
IRPMLAERLNDPVEIIKKLGGRALVEYKYDGERAQIHKKGDKIWIFSRRLENITHMYPDV
CCHHHHHHCCCHHHHHHHCCCCEEEEEEECCCHHHHHHCCCEEEEEHHHHHHHHHHCHHH
VEMAKKGIKAEEAIVEGEIVAIDPETGEFRPFQVLMHRRRKKDVHAVLSEIPVAVFLFDT
HHHHHCCCCHHHHHCCCEEEEECCCCCCCCHHHHHHHHHHHHHHHHHHHHCCHHHHHHHH
LYVNGEDLTLKPLPARHEVLEKIIEQSDTWRIAEGIVTSDPQELESFFLKAIEDGAEGVM
HEECCCCCEECCCCHHHHHHHHHHCCCCCEEHHCCCCCCCHHHHHHHHHHHHHHHHHHHH
AKAIHDRSIYQAGARGWLWIKYKRDYKSEMSDTVDLVVIGAFYGKGRRGGKFGALLMAAY
HHHHHHHHHHHCCCCCEEEEEECCHHHHHHHCCCCEEEEEEHHCCCCCCCCHHEEEEEEE
DPDTDTFKSVCKVGSGFTDEDLERLDDMLKPYISDKKPARVDSQMKPDVWVEPTLVAEII
CCCHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCHHHHHHHH
GAELTLSPIHTCCYGWVKSGAGISIRFPRFIRWRPDKGPEDATTTKELYEMYKRQLRRIK
CCCCCHHHHHHHHHHHHHCCCCEEEECCCCEEECCCCCCCCCHHHHHHHHHHHHHHHHHH
EEEAPTGV
HHCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA