| Definition | Hyperthermus butylicus DSM 5456 chromosome, complete genome. |
|---|---|
| Accession | NC_008818 |
| Length | 1,667,163 |
Click here to switch to the map view.
The map label for this gene is lig
Identifier: 124027312
GI number: 124027312
Start: 410095
End: 411921
Strand: Reverse
Name: lig
Synonym: Hbut_0421
Alternate gene names: 124027312
Gene position: 411921-410095 (Counterclockwise)
Preceding gene: 124027313
Following gene: 124027309
Centisome position: 24.71
GC content: 52.55
Gene sequence:
>1827_bases ATGTCTATGCCCTTCTCAGTGCTTGCGGAAACCTTCGAGAAGCTTGAAAGGGTTACAGCTAGAACCCAAATGCTACTATA TCTTGTAGAACTCTTCAAGAAGACGCCGCCAGAGATTATAGACAAGGTTGTCTACTTCATCCAGGGCAAGCTGTGGCCCG ACTGGAAGGGCCTACCAGAGCTTGGCATTGGCGAGAAGATGTTGATAAAGGCGGCCTCCATAGCCCTCCACGTATCCGAG AAGCAGATAGAGCAGCTTGTAAAGAAGCTGGGGGACACCGGTAAGGCTATTGAGATGATTAAACGGGAGAAGCAGCAAAA GCAGAAGGCAGTGGGCCTCCTAGCCTTCATGCAGAAGCCCTCTGGCGGCGAGAGCACGCTAACTGTGGAGAAGGTGTACG ACACTCTTGCAAGAATAGCGCTGGTTCAGGGTGAGGGTAGCAGAGATATCAAGCTCAAGCTGCTGGCGGGTCTCCTCGCG GAGGCTAGTCCGCGCGAGGCAAAGTACATTGCAAGATTTGTTGAGGGACGGTTAAGGCTTGGTGTGGGCGACGCCACCAT TATGGAGGCTTTAGCAGTAGTCTACGGCGGCAGTGCGGCGATGAGGAGTGTTGTTGAGAGGGCTTACAATCTCCGGGCAG ACCTAGGCATGGTGGCTAAGATACTTGCAACACAAGGTATAGACGCTCTCAAGAACATAAAGCCGGAGGTGGGAGTCCCG ATAAGGCCAATGCTCGCAGAGAGGCTCAACGATCCTGTCGAGATAATAAAGAAGCTCGGCGGCCGTGCCCTAGTAGAGTA CAAGTATGACGGTGAAAGGGCGCAAATACACAAGAAAGGCGATAAGATATGGATATTCTCCCGTCGTCTCGAAAACATAA CCCACATGTACCCAGATGTTGTTGAGATGGCTAAGAAGGGGATAAAGGCTGAGGAAGCTATCGTAGAGGGCGAGATAGTA GCGATTGACCCAGAGACTGGTGAGTTCCGGCCATTCCAGGTCCTCATGCACCGCAGGAGGAAGAAAGATGTACATGCAGT CCTCTCTGAGATACCTGTAGCAGTATTCCTCTTTGACACGCTATACGTTAACGGCGAAGACCTAACCTTGAAGCCCCTAC CAGCACGCCACGAGGTCCTCGAAAAGATCATAGAGCAGAGTGACACCTGGAGAATCGCCGAGGGCATAGTAACTAGCGAT CCCCAGGAGCTGGAGAGCTTCTTCCTCAAGGCAATCGAGGATGGTGCTGAAGGTGTAATGGCGAAGGCGATTCATGATCG TAGCATCTACCAGGCAGGCGCCAGGGGCTGGCTATGGATCAAGTATAAGAGGGACTACAAGTCCGAGATGAGCGACACGG TAGACCTAGTAGTCATAGGTGCATTCTACGGCAAGGGTAGACGCGGCGGCAAGTTCGGAGCACTGCTCATGGCGGCCTAT GACCCCGACACAGACACGTTCAAGAGCGTATGCAAGGTTGGCAGCGGCTTCACAGACGAGGACCTCGAACGTCTAGACGA TATGCTGAAACCCTACATCAGCGACAAGAAACCAGCAAGAGTTGATAGCCAAATGAAGCCGGACGTGTGGGTGGAGCCTA CGCTCGTGGCAGAGATCATTGGTGCAGAGCTAACGTTAAGCCCCATACATACATGCTGTTATGGCTGGGTCAAGTCTGGT GCGGGTATATCAATAAGATTCCCGCGCTTCATAAGGTGGAGGCCTGACAAAGGCCCCGAGGATGCTACCACTACAAAGGA GCTTTACGAGATGTATAAGAGACAGCTGAGAAGGATAAAGGAGGAGGAGGCACCAACCGGAGTCTAG
Upstream 100 bases:
>100_bases GTTTACCGGTACCGGCTTGGCTAGGCTGCAGGGCCCGGTTTTGCCTCCACGCTAATTAGCGGGTTTACCCGGAATTTATT CTAACTCGGGATGGTAGAGC
Downstream 100 bases:
>100_bases CTACGAGAAAGCTAGCACTACGGCCTTGCACGGCTAGTCATCTTCGGTATTTTCAGGTTACACATTGTAAGCCCTAGGCT AAATTAAGCCTCCTTAGCTA
Product: ATP-dependent DNA ligase
Products: NA
Alternate protein names: Polydeoxyribonucleotide synthase [ATP]
Number of amino acids: Translated: 608; Mature: 607
Protein sequence:
>608_residues MSMPFSVLAETFEKLERVTARTQMLLYLVELFKKTPPEIIDKVVYFIQGKLWPDWKGLPELGIGEKMLIKAASIALHVSE KQIEQLVKKLGDTGKAIEMIKREKQQKQKAVGLLAFMQKPSGGESTLTVEKVYDTLARIALVQGEGSRDIKLKLLAGLLA EASPREAKYIARFVEGRLRLGVGDATIMEALAVVYGGSAAMRSVVERAYNLRADLGMVAKILATQGIDALKNIKPEVGVP IRPMLAERLNDPVEIIKKLGGRALVEYKYDGERAQIHKKGDKIWIFSRRLENITHMYPDVVEMAKKGIKAEEAIVEGEIV AIDPETGEFRPFQVLMHRRRKKDVHAVLSEIPVAVFLFDTLYVNGEDLTLKPLPARHEVLEKIIEQSDTWRIAEGIVTSD PQELESFFLKAIEDGAEGVMAKAIHDRSIYQAGARGWLWIKYKRDYKSEMSDTVDLVVIGAFYGKGRRGGKFGALLMAAY DPDTDTFKSVCKVGSGFTDEDLERLDDMLKPYISDKKPARVDSQMKPDVWVEPTLVAEIIGAELTLSPIHTCCYGWVKSG AGISIRFPRFIRWRPDKGPEDATTTKELYEMYKRQLRRIKEEEAPTGV
Sequences:
>Translated_608_residues MSMPFSVLAETFEKLERVTARTQMLLYLVELFKKTPPEIIDKVVYFIQGKLWPDWKGLPELGIGEKMLIKAASIALHVSE KQIEQLVKKLGDTGKAIEMIKREKQQKQKAVGLLAFMQKPSGGESTLTVEKVYDTLARIALVQGEGSRDIKLKLLAGLLA EASPREAKYIARFVEGRLRLGVGDATIMEALAVVYGGSAAMRSVVERAYNLRADLGMVAKILATQGIDALKNIKPEVGVP IRPMLAERLNDPVEIIKKLGGRALVEYKYDGERAQIHKKGDKIWIFSRRLENITHMYPDVVEMAKKGIKAEEAIVEGEIV AIDPETGEFRPFQVLMHRRRKKDVHAVLSEIPVAVFLFDTLYVNGEDLTLKPLPARHEVLEKIIEQSDTWRIAEGIVTSD PQELESFFLKAIEDGAEGVMAKAIHDRSIYQAGARGWLWIKYKRDYKSEMSDTVDLVVIGAFYGKGRRGGKFGALLMAAY DPDTDTFKSVCKVGSGFTDEDLERLDDMLKPYISDKKPARVDSQMKPDVWVEPTLVAEIIGAELTLSPIHTCCYGWVKSG AGISIRFPRFIRWRPDKGPEDATTTKELYEMYKRQLRRIKEEEAPTGV >Mature_607_residues SMPFSVLAETFEKLERVTARTQMLLYLVELFKKTPPEIIDKVVYFIQGKLWPDWKGLPELGIGEKMLIKAASIALHVSEK QIEQLVKKLGDTGKAIEMIKREKQQKQKAVGLLAFMQKPSGGESTLTVEKVYDTLARIALVQGEGSRDIKLKLLAGLLAE ASPREAKYIARFVEGRLRLGVGDATIMEALAVVYGGSAAMRSVVERAYNLRADLGMVAKILATQGIDALKNIKPEVGVPI RPMLAERLNDPVEIIKKLGGRALVEYKYDGERAQIHKKGDKIWIFSRRLENITHMYPDVVEMAKKGIKAEEAIVEGEIVA IDPETGEFRPFQVLMHRRRKKDVHAVLSEIPVAVFLFDTLYVNGEDLTLKPLPARHEVLEKIIEQSDTWRIAEGIVTSDP QELESFFLKAIEDGAEGVMAKAIHDRSIYQAGARGWLWIKYKRDYKSEMSDTVDLVVIGAFYGKGRRGGKFGALLMAAYD PDTDTFKSVCKVGSGFTDEDLERLDDMLKPYISDKKPARVDSQMKPDVWVEPTLVAEIIGAELTLSPIHTCCYGWVKSGA GISIRFPRFIRWRPDKGPEDATTTKELYEMYKRQLRRIKEEEAPTGV
Specific function: DNA ligase that seals nicks in double-stranded DNA during DNA replication, DNA recombination and DNA repair
COG id: COG1793
COG function: function code L; ATP-dependent DNA ligase
Gene ontology:
Cell location: Cytoplasmic
Metaboloic importance: NA
Operon status: Not Known
Operon components: None
Similarity: Belongs to the ATP-dependent DNA ligase family
Homologues:
Organism=Homo sapiens, GI4557719, Length=636, Percent_Identity=34.1194968553459, Blast_Score=344, Evalue=2e-94, Organism=Homo sapiens, GI73747829, Length=543, Percent_Identity=29.6500920810313, Blast_Score=207, Evalue=3e-53, Organism=Homo sapiens, GI73747844, Length=543, Percent_Identity=29.6500920810313, Blast_Score=206, Evalue=5e-53, Organism=Homo sapiens, GI46255052, Length=631, Percent_Identity=26.148969889065, Blast_Score=157, Evalue=2e-38, Organism=Homo sapiens, GI23199993, Length=631, Percent_Identity=26.148969889065, Blast_Score=157, Evalue=2e-38, Organism=Homo sapiens, GI148539894, Length=631, Percent_Identity=26.148969889065, Blast_Score=157, Evalue=2e-38, Organism=Caenorhabditis elegans, GI71985269, Length=620, Percent_Identity=35.3225806451613, Blast_Score=357, Evalue=1e-98, Organism=Caenorhabditis elegans, GI71981465, Length=286, Percent_Identity=27.972027972028, Blast_Score=77, Evalue=3e-14, Organism=Caenorhabditis elegans, GI71985278, Length=196, Percent_Identity=26.530612244898, Blast_Score=75, Evalue=1e-13, Organism=Saccharomyces cerevisiae, GI6320038, Length=626, Percent_Identity=33.7060702875399, Blast_Score=313, Evalue=7e-86, Organism=Saccharomyces cerevisiae, GI6324578, Length=406, Percent_Identity=25.3694581280788, Blast_Score=91, Evalue=5e-19, Organism=Drosophila melanogaster, GI24762424, Length=624, Percent_Identity=33.974358974359, Blast_Score=332, Evalue=4e-91, Organism=Drosophila melanogaster, GI85815841, Length=559, Percent_Identity=28.8014311270125, Blast_Score=177, Evalue=1e-44, Organism=Drosophila melanogaster, GI24641829, Length=566, Percent_Identity=26.1484098939929, Blast_Score=108, Evalue=1e-23,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): DNLI_HYPBU (A2BJX6)
Other databases:
- EMBL: CP000493 - RefSeq: YP_001012632.1 - ProteinModelPortal: A2BJX6 - SMR: A2BJX6 - STRING: A2BJX6 - GeneID: 4781994 - GenomeReviews: CP000493_GR - KEGG: hbu:Hbut_0421 - eggNOG: arNOG04596 - HOGENOM: HBG570821 - OMA: EYQSICK - PhylomeDB: A2BJX6 - ProtClustDB: PRK01109 - BioCyc: HBUT415426:HBUT_0421-MONOMER - HAMAP: MF_00407 - InterPro: IPR022865 - InterPro: IPR000977 - InterPro: IPR012309 - InterPro: IPR012310 - InterPro: IPR016059 - InterPro: IPR012308 - InterPro: IPR012340 - InterPro: IPR016027 - Gene3D: G3DSA:2.40.50.140 - TIGRFAMs: TIGR00574
Pfam domain/function: PF04679 DNA_ligase_A_C; PF01068 DNA_ligase_A_M; PF04675 DNA_ligase_A_N; SSF50249 Nucleic_acid_OB
EC number: =6.5.1.1
Molecular weight: Translated: 68330; Mature: 68199
Theoretical pI: Translated: 8.79; Mature: 8.79
Prosite motif: PS00697 DNA_LIGASE_A1; PS00333 DNA_LIGASE_A2; PS50160 DNA_LIGASE_A3
Important sites: ACT_SITE 268-268 BINDING 266-266 BINDING 273-273 BINDING 288-288 BINDING 318-318 BINDING 358-358 BINDING 435-435 BINDING 441-441
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.5 %Cys (Translated Protein) 3.1 %Met (Translated Protein) 3.6 %Cys+Met (Translated Protein) 0.5 %Cys (Mature Protein) 3.0 %Met (Mature Protein) 3.5 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MSMPFSVLAETFEKLERVTARTQMLLYLVELFKKTPPEIIDKVVYFIQGKLWPDWKGLPE CCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHCCCCCCCCCCCC LGIGEKMLIKAASIALHVSEKQIEQLVKKLGDTGKAIEMIKREKQQKQKAVGLLAFMQKP CCCCHHHHHHHHHHHEECCHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHCCC SGGESTLTVEKVYDTLARIALVQGEGSRDIKLKLLAGLLAEASPREAKYIARFVEGRLRL CCCCCCEEHHHHHHHHHHHHHEECCCCCCHHHHHHHHHHHCCCCHHHHHHHHHHHCHHEE GVGDATIMEALAVVYGGSAAMRSVVERAYNLRADLGMVAKILATQGIDALKNIKPEVGVP CCCHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHCCCCCCCCC IRPMLAERLNDPVEIIKKLGGRALVEYKYDGERAQIHKKGDKIWIFSRRLENITHMYPDV CCHHHHHHCCCHHHHHHHCCCCEEEEEEECCCHHHHHHCCCEEEEEHHHHHHHHHHCHHH VEMAKKGIKAEEAIVEGEIVAIDPETGEFRPFQVLMHRRRKKDVHAVLSEIPVAVFLFDT HHHHHCCCCHHHHHCCCEEEEECCCCCCCCHHHHHHHHHHHHHHHHHHHHCCHHHHHHHH LYVNGEDLTLKPLPARHEVLEKIIEQSDTWRIAEGIVTSDPQELESFFLKAIEDGAEGVM HEECCCCCEECCCCHHHHHHHHHHCCCCCEEHHCCCCCCCHHHHHHHHHHHHHHHHHHHH AKAIHDRSIYQAGARGWLWIKYKRDYKSEMSDTVDLVVIGAFYGKGRRGGKFGALLMAAY HHHHHHHHHHHCCCCCEEEEEECCHHHHHHHCCCCEEEEEEHHCCCCCCCCHHEEEEEEE DPDTDTFKSVCKVGSGFTDEDLERLDDMLKPYISDKKPARVDSQMKPDVWVEPTLVAEII CCCHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCHHHHHHHH GAELTLSPIHTCCYGWVKSGAGISIRFPRFIRWRPDKGPEDATTTKELYEMYKRQLRRIK CCCCCHHHHHHHHHHHHHCCCCEEEECCCCEEECCCCCCCCCHHHHHHHHHHHHHHHHHH EEEAPTGV HHCCCCCC >Mature Secondary Structure SMPFSVLAETFEKLERVTARTQMLLYLVELFKKTPPEIIDKVVYFIQGKLWPDWKGLPE CCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHCCCCCCCCCCCC LGIGEKMLIKAASIALHVSEKQIEQLVKKLGDTGKAIEMIKREKQQKQKAVGLLAFMQKP CCCCHHHHHHHHHHHEECCHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHCCC SGGESTLTVEKVYDTLARIALVQGEGSRDIKLKLLAGLLAEASPREAKYIARFVEGRLRL CCCCCCEEHHHHHHHHHHHHHEECCCCCCHHHHHHHHHHHCCCCHHHHHHHHHHHCHHEE GVGDATIMEALAVVYGGSAAMRSVVERAYNLRADLGMVAKILATQGIDALKNIKPEVGVP CCCHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHCCCCCCCCC IRPMLAERLNDPVEIIKKLGGRALVEYKYDGERAQIHKKGDKIWIFSRRLENITHMYPDV CCHHHHHHCCCHHHHHHHCCCCEEEEEEECCCHHHHHHCCCEEEEEHHHHHHHHHHCHHH VEMAKKGIKAEEAIVEGEIVAIDPETGEFRPFQVLMHRRRKKDVHAVLSEIPVAVFLFDT HHHHHCCCCHHHHHCCCEEEEECCCCCCCCHHHHHHHHHHHHHHHHHHHHCCHHHHHHHH LYVNGEDLTLKPLPARHEVLEKIIEQSDTWRIAEGIVTSDPQELESFFLKAIEDGAEGVM HEECCCCCEECCCCHHHHHHHHHHCCCCCEEHHCCCCCCCHHHHHHHHHHHHHHHHHHHH AKAIHDRSIYQAGARGWLWIKYKRDYKSEMSDTVDLVVIGAFYGKGRRGGKFGALLMAAY HHHHHHHHHHHCCCCCEEEEEECCHHHHHHHCCCCEEEEEEHHCCCCCCCCHHEEEEEEE DPDTDTFKSVCKVGSGFTDEDLERLDDMLKPYISDKKPARVDSQMKPDVWVEPTLVAEII CCCHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCHHHHHHHH GAELTLSPIHTCCYGWVKSGAGISIRFPRFIRWRPDKGPEDATTTKELYEMYKRQLRRIK CCCCCHHHHHHHHHHHHHCCCCEEEECCCCEEECCCCCCCCCHHHHHHHHHHHHHHHHHH EEEAPTGV HHCCCCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: NA