Definition Eubacterium eligens ATCC 27750 plasmid unnamed, complete sequence.
Accession NC_012780
Length 626,744

Click here to switch to the map view.

The map label for this gene is 238922272

Identifier: 238922272

GI number: 238922272

Start: 467490

End: 469121

Strand: Reverse

Name: 238922272

Synonym: EUBELI_20507

Alternate gene names: NA

Gene position: 469121-467490 (Counterclockwise)

Preceding gene: 238922273

Following gene: 238922271

Centisome position: 74.85

GC content: 37.19

Gene sequence:

>1632_bases
ATGGCAAGATATTACTATAAAAAGAAAAAGAAGAAATTCGTACCTAAAGATTTGGCAAGTCTTAAGGAACTTAAGATAAA
GACCGCATTAATGGAGAGTATTCCTGAGGATATAACACAGCTGTATCCTGAAGCCAGAAATATAAAGAGACATTTTATAT
TGCATATAGGAGAGACTAATACAGGAAAGACACATGATGCATTAGAAGATTTTTATAATGCCGGTTCAGGAATGTATCTT
GCACCCCTGAGACTTCTTGCACTTGAGATTCAGGAGATGAGTCTTGCAAGAGGAATTAACTGTTCGTTGACGACAGGTGA
GGAGAAGGATATAAGAGATGGTGCAAAGCATTTATCCTGTACAGTTGAGAAAATGGATATGAGCAGACATTTTGATGTCT
GTGTAATAGATGAGGCACAGATGGTAGCTGACTCAGACAGAGGCTGGGCGTGGACAGAGGCAATTCTTGGCGTCAATGCT
GATGTTGTACATGTATGCATGTCGCCGAATGCAATACATATTGTTAAAATGCTTATAAAAATGTGTGGAGATACATATAC
GGATATAAGACATAAAAGGAATTCAAGACTTATAGTTGAAGATCATGATTTCATATTTCCGGATGATATACGGGATGGAG
ATGCTTTAGTATCATTTTCACGTAGAAAAGTTCTTATGCTCGCAACTCTTCTAAAGAAGGAAGGGTATAAAGTAAGTGTT
ATATACGGTTCACTTCCATACAGTGTGCGAAAAGCAGAGGTTGCCAGATTCTTAAATGGAGAGAGCAGAATTGTAGTATG
TACAGATGCTATTGGAATGGGAGTAAATCTTCCTATAAGAAGAATAATATTTACTGAGTCGAAAAAATTCGATGGCAAAT
CCAAAAGATTTCTTAACATGAGTGAGGTTAAGCAGATTGCCGGAAGAGCAGGAAGAAAGGGAATGTATGACCAGGGGTAT
GTCAACTCAATAGAGGACAGGGACCAGATAGGTGAACTGCTTCATGGAAGATATGAGCAGATAACAAGCTGCGTTATACA
GCCGCCAAGAAAAGTTCTGGATATGCCATACAGCCTTTCAGAGATATTTAAGATATGGTTAAAGACGATTGAAAAGAAAT
GCTTTTCAGTTGCTGACTTAAAGAACAGGATTAAACTTGCTGAATACATTGAGAAAAAACATGGTGAGAAGATTAATAAA
GATCTTGAATACAGTCTTATTAACATTCCATTTGATGAGAATAACGAGAAACTTAAATATTTGTGGCAGGATCTTGTTGA
TATGACAGCTGACGGTGAACCGGTAAGCAGGATGTGGTATTATGTAGATACTGAATCTGAAGATATAGAAGCCATGAAGC
TGGATGACCTTGAACAGTTGTATAAGAAGATGGATCTGCTTAATTCATACTGTAATGCTCTTAATATATCAGAATATGAT
GAGCGTATCAGAATGCTTAAAGAGGAGATATCAGAACGCATAGTAAGAGAACTTACTAATGGTGAATTCTTCAACAAATG
TAAACGCTGTGGGAAGAGACTGGAATGGAATCACAGATTTGGCATGTGTGAAAAATGTTACGAGATAAATAAGCTGGAAA
GAATGCGCTATAAAGCAGGTAAATGGAGATAA

Upstream 100 bases:

>100_bases
AATAATCAGACTGACCTTACAGAAAGAAGCGTGACAATATGTAATGTTTTATGTATTGTCATGCTTCTTGTTTATATTTC
AGAAAACAATAGGAAAATAA

Downstream 100 bases:

>100_bases
AAAGGTCTACATTTTGCTTTTTTATGCGAACATAAGCAATTCGAACTGACAATATATAGGGGATATGTTATATTTAATGC
ACCAAATATATGTTTTTATA

Product: adenosinetriphosphatase

Products: NA

Alternate protein names: Helicase Domain Protein; Helicase; Helicase-Like; Helicase Conserved C-Terminal Domain Protein; ATP-Dependent Helicase; ATP-Dependent RNA Helicase; ATP-Dependent DNA Helicase; ATP-Dependent DNA Helicase Protein; MgpS ATP-Dependent Helicase; RNA Helicase; Superfamily II DNA/RNA Helicase; Helicase-Like Protein; Superfamily II DNA And RNA Helicase; ATP-Dependent RNA And DNA Helicase; ATP Dependent RNA Helicase; Adenosinetriphosphatase; RNA Helicase RhrA; ATP-Dependent Helicase MgpS; ATP-Dependent RNA Helicase Superfamily II; Helicase C-Terminal Domain Protein; DNA Helicase; DEAD/DEAH Box Helicase Domain Protein; ATP-Dependent DNA And RNA Helicase Protein

Number of amino acids: Translated: 543; Mature: 542

Protein sequence:

>543_residues
MARYYYKKKKKKFVPKDLASLKELKIKTALMESIPEDITQLYPEARNIKRHFILHIGETNTGKTHDALEDFYNAGSGMYL
APLRLLALEIQEMSLARGINCSLTTGEEKDIRDGAKHLSCTVEKMDMSRHFDVCVIDEAQMVADSDRGWAWTEAILGVNA
DVVHVCMSPNAIHIVKMLIKMCGDTYTDIRHKRNSRLIVEDHDFIFPDDIRDGDALVSFSRRKVLMLATLLKKEGYKVSV
IYGSLPYSVRKAEVARFLNGESRIVVCTDAIGMGVNLPIRRIIFTESKKFDGKSKRFLNMSEVKQIAGRAGRKGMYDQGY
VNSIEDRDQIGELLHGRYEQITSCVIQPPRKVLDMPYSLSEIFKIWLKTIEKKCFSVADLKNRIKLAEYIEKKHGEKINK
DLEYSLINIPFDENNEKLKYLWQDLVDMTADGEPVSRMWYYVDTESEDIEAMKLDDLEQLYKKMDLLNSYCNALNISEYD
ERIRMLKEEISERIVRELTNGEFFNKCKRCGKRLEWNHRFGMCEKCYEINKLERMRYKAGKWR

Sequences:

>Translated_543_residues
MARYYYKKKKKKFVPKDLASLKELKIKTALMESIPEDITQLYPEARNIKRHFILHIGETNTGKTHDALEDFYNAGSGMYL
APLRLLALEIQEMSLARGINCSLTTGEEKDIRDGAKHLSCTVEKMDMSRHFDVCVIDEAQMVADSDRGWAWTEAILGVNA
DVVHVCMSPNAIHIVKMLIKMCGDTYTDIRHKRNSRLIVEDHDFIFPDDIRDGDALVSFSRRKVLMLATLLKKEGYKVSV
IYGSLPYSVRKAEVARFLNGESRIVVCTDAIGMGVNLPIRRIIFTESKKFDGKSKRFLNMSEVKQIAGRAGRKGMYDQGY
VNSIEDRDQIGELLHGRYEQITSCVIQPPRKVLDMPYSLSEIFKIWLKTIEKKCFSVADLKNRIKLAEYIEKKHGEKINK
DLEYSLINIPFDENNEKLKYLWQDLVDMTADGEPVSRMWYYVDTESEDIEAMKLDDLEQLYKKMDLLNSYCNALNISEYD
ERIRMLKEEISERIVRELTNGEFFNKCKRCGKRLEWNHRFGMCEKCYEINKLERMRYKAGKWR
>Mature_542_residues
ARYYYKKKKKKFVPKDLASLKELKIKTALMESIPEDITQLYPEARNIKRHFILHIGETNTGKTHDALEDFYNAGSGMYLA
PLRLLALEIQEMSLARGINCSLTTGEEKDIRDGAKHLSCTVEKMDMSRHFDVCVIDEAQMVADSDRGWAWTEAILGVNAD
VVHVCMSPNAIHIVKMLIKMCGDTYTDIRHKRNSRLIVEDHDFIFPDDIRDGDALVSFSRRKVLMLATLLKKEGYKVSVI
YGSLPYSVRKAEVARFLNGESRIVVCTDAIGMGVNLPIRRIIFTESKKFDGKSKRFLNMSEVKQIAGRAGRKGMYDQGYV
NSIEDRDQIGELLHGRYEQITSCVIQPPRKVLDMPYSLSEIFKIWLKTIEKKCFSVADLKNRIKLAEYIEKKHGEKINKD
LEYSLINIPFDENNEKLKYLWQDLVDMTADGEPVSRMWYYVDTESEDIEAMKLDDLEQLYKKMDLLNSYCNALNISEYDE
RIRMLKEEISERIVRELTNGEFFNKCKRCGKRLEWNHRFGMCEKCYEINKLERMRYKAGKWR

Specific function: Unknown

COG id: COG0513

COG function: function code LKJ; Superfamily II DNA and RNA helicases

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

Organism=Homo sapiens, GI31543667, Length=456, Percent_Identity=33.3333333333333, Blast_Score=223, Evalue=4e-58,
Organism=Homo sapiens, GI193211480, Length=106, Percent_Identity=36.7924528301887, Blast_Score=68, Evalue=3e-11,
Organism=Caenorhabditis elegans, GI115532784, Length=445, Percent_Identity=33.0337078651685, Blast_Score=224, Evalue=8e-59,
Organism=Caenorhabditis elegans, GI115532782, Length=445, Percent_Identity=33.0337078651685, Blast_Score=224, Evalue=9e-59,
Organism=Caenorhabditis elegans, GI17542826, Length=91, Percent_Identity=34.0659340659341, Blast_Score=67, Evalue=3e-11,
Organism=Saccharomyces cerevisiae, GI6325228, Length=404, Percent_Identity=38.3663366336634, Blast_Score=235, Evalue=1e-62,
Organism=Drosophila melanogaster, GI221329989, Length=372, Percent_Identity=35.2150537634409, Blast_Score=215, Evalue=8e-56,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 63201; Mature: 63070

Theoretical pI: Translated: 8.33; Mature: 8.33

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

2.4 %Cys     (Translated Protein)
4.1 %Met     (Translated Protein)
6.4 %Cys+Met (Translated Protein)
2.4 %Cys     (Mature Protein)
3.9 %Met     (Mature Protein)
6.3 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MARYYYKKKKKKFVPKDLASLKELKIKTALMESIPEDITQLYPEARNIKRHFILHIGETN
CCCHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHCCCEEEEEEECCCC
TGKTHDALEDFYNAGSGMYLAPLRLLALEIQEMSLARGINCSLTTGEEKDIRDGAKHLSC
CCCCHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHCCCCCEECCCCCHHHHHHHHHHHH
TVEKMDMSRHFDVCVIDEAQMVADSDRGWAWTEAILGVNADVVHVCMSPNAIHIVKMLIK
HHHHHHHHCCCCEEEECCHHHHHCCCCCCCHHHHHHCCCCCEEEEECCCCHHHHHHHHHH
MCGDTYTDIRHKRNSRLIVEDHDFIFPDDIRDGDALVSFSRRKVLMLATLLKKEGYKVSV
HHCCHHHHHHHCCCCEEEEECCCEECCCCCCCCHHHHHHHHHHHHHHHHHHHCCCCEEEE
IYGSLPYSVRKAEVARFLNGESRIVVCTDAIGMGVNLPIRRIIFTESKKFDGKSKRFLNM
EEECCCCHHHHHHHHHHHCCCCEEEEEECCCCCCCCCCHHHEEEECCCCCCCCHHHCCCH
SEVKQIAGRAGRKGMYDQGYVNSIEDRDQIGELLHGRYEQITSCVIQPPRKVLDMPYSLS
HHHHHHHHCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCHHHHCCCCCHH
EIFKIWLKTIEKKCFSVADLKNRIKLAEYIEKKHGEKINKDLEYSLINIPFDENNEKLKY
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCEEEEECCCCCCCHHHHH
LWQDLVDMTADGEPVSRMWYYVDTESEDIEAMKLDDLEQLYKKMDLLNSYCNALNISEYD
HHHHHHHHCCCCCCCEEEEEEEECCCCCCHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHH
ERIRMLKEEISERIVRELTNGEFFNKCKRCGKRLEWNHRFGMCEKCYEINKLERMRYKAG
HHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHCC
KWR
CCC
>Mature Secondary Structure 
ARYYYKKKKKKFVPKDLASLKELKIKTALMESIPEDITQLYPEARNIKRHFILHIGETN
CCHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHCCCEEEEEEECCCC
TGKTHDALEDFYNAGSGMYLAPLRLLALEIQEMSLARGINCSLTTGEEKDIRDGAKHLSC
CCCCHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHCCCCCEECCCCCHHHHHHHHHHHH
TVEKMDMSRHFDVCVIDEAQMVADSDRGWAWTEAILGVNADVVHVCMSPNAIHIVKMLIK
HHHHHHHHCCCCEEEECCHHHHHCCCCCCCHHHHHHCCCCCEEEEECCCCHHHHHHHHHH
MCGDTYTDIRHKRNSRLIVEDHDFIFPDDIRDGDALVSFSRRKVLMLATLLKKEGYKVSV
HHCCHHHHHHHCCCCEEEEECCCEECCCCCCCCHHHHHHHHHHHHHHHHHHHCCCCEEEE
IYGSLPYSVRKAEVARFLNGESRIVVCTDAIGMGVNLPIRRIIFTESKKFDGKSKRFLNM
EEECCCCHHHHHHHHHHHCCCCEEEEEECCCCCCCCCCHHHEEEECCCCCCCCHHHCCCH
SEVKQIAGRAGRKGMYDQGYVNSIEDRDQIGELLHGRYEQITSCVIQPPRKVLDMPYSLS
HHHHHHHHCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCHHHHCCCCCHH
EIFKIWLKTIEKKCFSVADLKNRIKLAEYIEKKHGEKINKDLEYSLINIPFDENNEKLKY
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCEEEEECCCCCCCHHHHH
LWQDLVDMTADGEPVSRMWYYVDTESEDIEAMKLDDLEQLYKKMDLLNSYCNALNISEYD
HHHHHHHHCCCCCCCEEEEEEEECCCCCCHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHH
ERIRMLKEEISERIVRELTNGEFFNKCKRCGKRLEWNHRFGMCEKCYEINKLERMRYKAG
HHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHCC
KWR
CCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA