Definition Cupriavidus necator megaplasmid pHG1, complete sequence.
Accession NC_005241
Length 452,156

Click here to switch to the map view.

The map label for this gene is helD [H]

Identifier: 38638032

GI number: 38638032

Start: 384767

End: 386494

Strand: Direct

Name: helD [H]

Synonym: PHG371

Alternate gene names: 38638032

Gene position: 384767-386494 (Clockwise)

Preceding gene: 38638031

Following gene: 38638033

Centisome position: 85.1

GC content: 60.01

Gene sequence:

>1728_bases
ATGTCGCTCGAAAAGGTATTGGAAGGACTGAACCCCGCCCAGCGCGAGGTGGTCGACCTCCGTCAGCACTGCGTCGCCGT
GGCCGTGCCAGGCGCCGGAAAGACAGCGACGATTGCGGCCAAGGCAGCAGTGCTGCTCGCCAACCCAGACGTGACGGTGG
GCGCGGTAACGTTCAGCAAGGACGCCGCGGTCGAATTGCGTGACCGGATCCTGGCGCTAGCCGGTGCCGATGCCAGGAAG
CGACTGCTCGCGGGCACCTTTCATTCGCTGGCCTATAAGCAGCTCGGGAAGGGAACCGGCAAGCTCACCGATATCGTCCA
CGACGGCGTTCGATTCGCTATCGTCGGGCAGATCCTGCAGGAAGGGGGATTTGATGGGAAGGTCGAGGACGCGATCGCCG
CGATTGAGCGCGCCAAGATGCAACTGTCCGACCCGCCTTCAGGAACCGTGGAGGCTCAGTTGTATGAAGCCTACCAGAGT
GCTCTGGCCCGAAACGGCAAGATCGACTTTCAGGACATGCTGCGGTTGGCTGTAGCTGGAATGCAAAGCGGAACAATTGC
GCCCTACCGTATGACGTACCTGCTTGTCGATGAGTACCAGGATTGCGACAGCTTGCAATCACGCTGGACGGCGCTGCACG
CGGCGGCCGGTTCGATAGTGACGGTGGTCGGGGACGATGATCAGTCGATCTACGGATTTCGAAGTGCGCTCGGATTTCGA
GGCATGGAGGCATTCATCAAAGAGTTCGACGCGCGGTCAGTCATCCTCGGGAAGAACTACCGCTCACATGCCGAGATCCT
GGACGTCGCGGATCGGGTCATTCGAAACAACGAGGACCGTATCCTGAAGGAGCTGGTAGCCCATCGCGGGCCTGGCGGCG
CTATCGAGTTCAAGCGTTTGGAGGACGAGTACAAGGAGGCGGTTTCGGCCGTTGAGGCGCTGACACCGGTTTTGCGGGCT
GGCAAAACGGCGGCCGTGCTGGCGCGGACGAACCGCATTCTCGATCCATTGGAGGCCGTCTGCCGCTCGCACGGTGTCAA
GTATTACAGGGCAGCCGGCCGCTCTATTCTCGATCGCCCGGAGGCAGCGTTGATGGGGGACCTACTGGAACTGATTCAGA
AGTCCAAGGACTCTGGCACCGATGCCCTGCTAGGTTTCGCCGGAATTGGCTCGCATGAACTGCAGCTGCTACACACGCAG
ACTGCGGCGAAGCCGGAGGGATCGATTCCGCGAAAAAAGAACCTGGTGCAGGCCGGGATCGCAGAAGCAACAGTCGACAA
GTATCGCGACTTCCTAAAGAAGCTGGCGGAATGGCAAGCGCTCTTTGAGCGCCAGTTCTTTTCCCTCGTTCTCGATGGCG
TGCGCGAATGGATGCTCAAGTTTGTTGCGGACGACCCGGGCAAGCGCGCTATCAATACCGCGTTTGACGTCCTGACGCGG
CTGAACGGTCCATTTTCGGAACGACTCTTGTTTCTGCGCCAAAAGAATAACGAACCGGCCGACGACGCCTTGGTGCTGAC
GACCATGCATGCCTCCAAGGGACGCGAATGGTCGGCTGTTGTTGTGATCCGGGCCGAGGAAACCATCGTTCCGGACGAAG
CCAGTCCGGAGAGTGAGGAGCGTCGACTGTTCTACGTTGCCCTCACGCGCGCGCGCGACTGGCTGCAGATTTCTACGGCA
AAGAAGAACCCCACGTCCCGGTTCGTTATTGAAGCCGGGCTAACTTGA

Upstream 100 bases:

>100_bases
GAATCAATAGGCGTCGACATCTGCCCCGAGGTACCACTTCGGGGCACTTGCTGTTTTGAACCGGCACCAAGTGCCACTTA
CTGCCACACTGCGATCCGCC

Downstream 100 bases:

>100_bases
TTTGTTAAGCAGCCGGTCATTCGTGGTGTCTGCTGGTTGCGAGCTCCCTGCCATCGTGTGTGCCACAGCCGTCCGGCACG
TCATTTTTGTGCGTAGCGGT

Product: DNA helicase superfamily protein I

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 575; Mature: 574

Protein sequence:

>575_residues
MSLEKVLEGLNPAQREVVDLRQHCVAVAVPGAGKTATIAAKAAVLLANPDVTVGAVTFSKDAAVELRDRILALAGADARK
RLLAGTFHSLAYKQLGKGTGKLTDIVHDGVRFAIVGQILQEGGFDGKVEDAIAAIERAKMQLSDPPSGTVEAQLYEAYQS
ALARNGKIDFQDMLRLAVAGMQSGTIAPYRMTYLLVDEYQDCDSLQSRWTALHAAAGSIVTVVGDDDQSIYGFRSALGFR
GMEAFIKEFDARSVILGKNYRSHAEILDVADRVIRNNEDRILKELVAHRGPGGAIEFKRLEDEYKEAVSAVEALTPVLRA
GKTAAVLARTNRILDPLEAVCRSHGVKYYRAAGRSILDRPEAALMGDLLELIQKSKDSGTDALLGFAGIGSHELQLLHTQ
TAAKPEGSIPRKKNLVQAGIAEATVDKYRDFLKKLAEWQALFERQFFSLVLDGVREWMLKFVADDPGKRAINTAFDVLTR
LNGPFSERLLFLRQKNNEPADDALVLTTMHASKGREWSAVVVIRAEETIVPDEASPESEERRLFYVALTRARDWLQISTA
KKNPTSRFVIEAGLT

Sequences:

>Translated_575_residues
MSLEKVLEGLNPAQREVVDLRQHCVAVAVPGAGKTATIAAKAAVLLANPDVTVGAVTFSKDAAVELRDRILALAGADARK
RLLAGTFHSLAYKQLGKGTGKLTDIVHDGVRFAIVGQILQEGGFDGKVEDAIAAIERAKMQLSDPPSGTVEAQLYEAYQS
ALARNGKIDFQDMLRLAVAGMQSGTIAPYRMTYLLVDEYQDCDSLQSRWTALHAAAGSIVTVVGDDDQSIYGFRSALGFR
GMEAFIKEFDARSVILGKNYRSHAEILDVADRVIRNNEDRILKELVAHRGPGGAIEFKRLEDEYKEAVSAVEALTPVLRA
GKTAAVLARTNRILDPLEAVCRSHGVKYYRAAGRSILDRPEAALMGDLLELIQKSKDSGTDALLGFAGIGSHELQLLHTQ
TAAKPEGSIPRKKNLVQAGIAEATVDKYRDFLKKLAEWQALFERQFFSLVLDGVREWMLKFVADDPGKRAINTAFDVLTR
LNGPFSERLLFLRQKNNEPADDALVLTTMHASKGREWSAVVVIRAEETIVPDEASPESEERRLFYVALTRARDWLQISTA
KKNPTSRFVIEAGLT
>Mature_574_residues
SLEKVLEGLNPAQREVVDLRQHCVAVAVPGAGKTATIAAKAAVLLANPDVTVGAVTFSKDAAVELRDRILALAGADARKR
LLAGTFHSLAYKQLGKGTGKLTDIVHDGVRFAIVGQILQEGGFDGKVEDAIAAIERAKMQLSDPPSGTVEAQLYEAYQSA
LARNGKIDFQDMLRLAVAGMQSGTIAPYRMTYLLVDEYQDCDSLQSRWTALHAAAGSIVTVVGDDDQSIYGFRSALGFRG
MEAFIKEFDARSVILGKNYRSHAEILDVADRVIRNNEDRILKELVAHRGPGGAIEFKRLEDEYKEAVSAVEALTPVLRAG
KTAAVLARTNRILDPLEAVCRSHGVKYYRAAGRSILDRPEAALMGDLLELIQKSKDSGTDALLGFAGIGSHELQLLHTQT
AAKPEGSIPRKKNLVQAGIAEATVDKYRDFLKKLAEWQALFERQFFSLVLDGVREWMLKFVADDPGKRAINTAFDVLTRL
NGPFSERLLFLRQKNNEPADDALVLTTMHASKGREWSAVVVIRAEETIVPDEASPESEERRLFYVALTRARDWLQISTAK
KNPTSRFVIEAGLT

Specific function: Essential helicase [H]

COG id: COG0210

COG function: function code L; Superfamily I DNA and RNA helicases

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 uvrD-like helicase C-terminal domain [H]

Homologues:

Organism=Escherichia coli, GI2367296, Length=619, Percent_Identity=26.6558966074313, Blast_Score=147, Evalue=1e-36,
Organism=Escherichia coli, GI48994965, Length=643, Percent_Identity=27.6827371695179, Blast_Score=146, Evalue=3e-36,
Organism=Saccharomyces cerevisiae, GI6322369, Length=443, Percent_Identity=26.410835214447, Blast_Score=102, Evalue=2e-22,

Paralogues:

None

Copy number: 3000 [C]

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR005751
- InterPro:   IPR013986
- InterPro:   IPR014017
- InterPro:   IPR000212
- InterPro:   IPR014016 [H]

Pfam domain/function: PF00580 UvrD-helicase [H]

EC number: =3.6.4.12 [H]

Molecular weight: Translated: 62986; Mature: 62855

Theoretical pI: Translated: 7.08; Mature: 7.08

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.5 %Cys     (Translated Protein)
1.6 %Met     (Translated Protein)
2.1 %Cys+Met (Translated Protein)
0.5 %Cys     (Mature Protein)
1.4 %Met     (Mature Protein)
1.9 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSLEKVLEGLNPAQREVVDLRQHCVAVAVPGAGKTATIAAKAAVLLANPDVTVGAVTFSK
CCHHHHHHCCCHHHHHHHHHHHHHEEEEECCCCCCEEEEEHEEEEEECCCCEEEEEEECC
DAAVELRDRILALAGADARKRLLAGTFHSLAYKQLGKGTGKLTDIVHDGVRFAIVGQILQ
CHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHCCHHHHHHHHHHH
EGGFDGKVEDAIAAIERAKMQLSDPPSGTVEAQLYEAYQSALARNGKIDFQDMLRLAVAG
CCCCCCHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHC
MQSGTIAPYRMTYLLVDEYQDCDSLQSRWTALHAAAGSIVTVVGDDDQSIYGFRSALGFR
CCCCCCCCEEEEEEEECCCCCHHHHHHHHHHHHHCCCCEEEEECCCCCHHHHHHHHHHHH
GMEAFIKEFDARSVILGKNYRSHAEILDVADRVIRNNEDRILKELVAHRGPGGAIEFKRL
HHHHHHHHHCCCEEEECCCCHHHHHHHHHHHHHHCCCHHHHHHHHHHCCCCCCCEEHHHH
EDEYKEAVSAVEALTPVLRAGKTAAVLARTNRILDPLEAVCRSHGVKYYRAAGRSILDRP
HHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHCHHHHCCC
EAALMGDLLELIQKSKDSGTDALLGFAGIGSHELQLLHTQTAAKPEGSIPRKKNLVQAGI
HHHHHHHHHHHHHHCCCCCCHHHHEECCCCCCCEEEEEHHHCCCCCCCCCHHHHHHHHHH
AEATVDKYRDFLKKLAEWQALFERQFFSLVLDGVREWMLKFVADDPGKRAINTAFDVLTR
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHH
LNGPFSERLLFLRQKNNEPADDALVLTTMHASKGREWSAVVVIRAEETIVPDEASPESEE
CCCCHHHHHHHHHHCCCCCCCCEEEEEEEECCCCCCEEEEEEEEECCEECCCCCCCCCHH
RRLFYVALTRARDWLQISTAKKNPTSRFVIEAGLT
CEEEEEEEECCCCCEEEECCCCCCCCEEEEECCCC
>Mature Secondary Structure 
SLEKVLEGLNPAQREVVDLRQHCVAVAVPGAGKTATIAAKAAVLLANPDVTVGAVTFSK
CHHHHHHCCCHHHHHHHHHHHHHEEEEECCCCCCEEEEEHEEEEEECCCCEEEEEEECC
DAAVELRDRILALAGADARKRLLAGTFHSLAYKQLGKGTGKLTDIVHDGVRFAIVGQILQ
CHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHCCHHHHHHHHHHH
EGGFDGKVEDAIAAIERAKMQLSDPPSGTVEAQLYEAYQSALARNGKIDFQDMLRLAVAG
CCCCCCHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHC
MQSGTIAPYRMTYLLVDEYQDCDSLQSRWTALHAAAGSIVTVVGDDDQSIYGFRSALGFR
CCCCCCCCEEEEEEEECCCCCHHHHHHHHHHHHHCCCCEEEEECCCCCHHHHHHHHHHHH
GMEAFIKEFDARSVILGKNYRSHAEILDVADRVIRNNEDRILKELVAHRGPGGAIEFKRL
HHHHHHHHHCCCEEEECCCCHHHHHHHHHHHHHHCCCHHHHHHHHHHCCCCCCCEEHHHH
EDEYKEAVSAVEALTPVLRAGKTAAVLARTNRILDPLEAVCRSHGVKYYRAAGRSILDRP
HHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHCHHHHCCC
EAALMGDLLELIQKSKDSGTDALLGFAGIGSHELQLLHTQTAAKPEGSIPRKKNLVQAGI
HHHHHHHHHHHHHHCCCCCCHHHHEECCCCCCCEEEEEHHHCCCCCCCCCHHHHHHHHHH
AEATVDKYRDFLKKLAEWQALFERQFFSLVLDGVREWMLKFVADDPGKRAINTAFDVLTR
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHH
LNGPFSERLLFLRQKNNEPADDALVLTTMHASKGREWSAVVVIRAEETIVPDEASPESEE
CCCCHHHHHHHHHHCCCCCCCCEEEEEEEECCCCCCEEEEEEEEECCEECCCCCCCCCHH
RRLFYVALTRARDWLQISTAKKNPTSRFVIEAGLT
CEEEEEEEECCCCCEEEECCCCCCCCEEEEECCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA