The gene/protein map for NC_011126 is currently unavailable.
Definition Hydrogenobaculum sp. Y04AAS1 chromosome, complete genome.
Accession NC_011126
Length 1,559,514

Click here to switch to the map view.

The map label for this gene is engD [H]

Identifier: 195952890

GI number: 195952890

Start: 451692

End: 452798

Strand: Direct

Name: engD [H]

Synonym: HY04AAS1_0515

Alternate gene names: 195952890

Gene position: 451692-452798 (Clockwise)

Preceding gene: 195952889

Following gene: 195952891

Centisome position: 28.96

GC content: 35.5

Gene sequence:

>1107_bases
ATGCCCCTTAGTTGCGGTATAGTTGGTTTACCGAACGTAGGAAAGTCTACGTTATTTAATGCTCTTATAAAGGCAGCCAA
AGCTCAGGCTGCCAATTATCCATTTTGTACAATAGAGCCAAACATAGGCACGGTGGAAGTCCCAGACGAAAGGCTTTACG
AAATAGCAAGGTTAGAAAACTCTGCCAAAGTAGTGCCAACATTTATAGAGTTTGTGGATATAGCTGGTTTGGTAAGGGGT
GCAAGTAAGGGCGAGGGCCTTGGAAATCAATTTTTATCACACATAAGAAATGTAGATGCCATAGTACAAGTGGTAAGATG
TTTTGAAGATGAGAACATTACACACGTTGAAGGCTCAGTGAATCCCATAAGGGATATAGAAATTATAGATTTAGAGCTTA
TAGCAAAAGACTTAGAATCCGTACAAAAAACTATTCAAAAAATAGAAAAAATTGCAAAAGGCGGAAATCAAGAAGCAAAA
CAAGAGTTAGAATACTTAAAAAAGTTTGAAGAGATTTTAAACCCAATGATTCCCTTAAGAAGGGCTAATCTCACAGAAGA
AGAGAAAGAATATGCAAAAAATAAGCTATTTCTTCTTAGCATTAAACCTACAATGTTTGTAGCAAATTTATCTGAAGAAG
AAATTCAAGGACCTACTTCCAACAAACATTACAGAAATCTATTGGAATATGCAGAAAAAGAAAATGCTCCAGTAATTCCA
GTGTGTGCAAAGCTAGAGTCAGAAATGATTGATATGTCAAAAGAAGAAGTTCAAGAAATGTTAAACCTTTATGGTTTAAA
AGAAACCGGCTTATCTTCTATTATTAAAAGCGGGTATAAACTTTTGGGGCTTATAACGTTTTTTACCGCTGGTCCAAAAG
AATCTAGGGCTTGGGCTATTGCAAAAGATACCAAAGCTCAAAAGGCTGCTGGCAAAATACATTCTGATATAGAAAGAGGC
TTTATAGCTGCAGAAGTAATAAACTACGATGACTATATAAAAGTTAAGTCCATGACAAAGGCAAAAGAGCAAGGGCTTAT
AAGGTTGGAGGGAAAAGACTACATTGTAAAAGATGGTGATATAATATACTTTAGATTCAACGTATAA

Upstream 100 bases:

>100_bases
AGTGGCTTCAGCGGCTGCCAACGGTGCTATAGAAGGAGCCAAAAAAGCTTTAGAAGAAGGGGAGAAGAAGGAGCAAAACC
AAGGAGAAAAGCAAGAGTAA

Downstream 100 bases:

>100_bases
AGAGGTTCTAGTATGAAAATAGTATTTAACAATCAAGAATATGATCTGCAAGCAGGAATAGTTGGTATTGAGCTTTTAAA
AGCTTTAAACTTAGATTCAA

Product: GTP-dependent nucleic acid-binding protein EngD

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 368; Mature: 367

Protein sequence:

>368_residues
MPLSCGIVGLPNVGKSTLFNALIKAAKAQAANYPFCTIEPNIGTVEVPDERLYEIARLENSAKVVPTFIEFVDIAGLVRG
ASKGEGLGNQFLSHIRNVDAIVQVVRCFEDENITHVEGSVNPIRDIEIIDLELIAKDLESVQKTIQKIEKIAKGGNQEAK
QELEYLKKFEEILNPMIPLRRANLTEEEKEYAKNKLFLLSIKPTMFVANLSEEEIQGPTSNKHYRNLLEYAEKENAPVIP
VCAKLESEMIDMSKEEVQEMLNLYGLKETGLSSIIKSGYKLLGLITFFTAGPKESRAWAIAKDTKAQKAAGKIHSDIERG
FIAAEVINYDDYIKVKSMTKAKEQGLIRLEGKDYIVKDGDIIYFRFNV

Sequences:

>Translated_368_residues
MPLSCGIVGLPNVGKSTLFNALIKAAKAQAANYPFCTIEPNIGTVEVPDERLYEIARLENSAKVVPTFIEFVDIAGLVRG
ASKGEGLGNQFLSHIRNVDAIVQVVRCFEDENITHVEGSVNPIRDIEIIDLELIAKDLESVQKTIQKIEKIAKGGNQEAK
QELEYLKKFEEILNPMIPLRRANLTEEEKEYAKNKLFLLSIKPTMFVANLSEEEIQGPTSNKHYRNLLEYAEKENAPVIP
VCAKLESEMIDMSKEEVQEMLNLYGLKETGLSSIIKSGYKLLGLITFFTAGPKESRAWAIAKDTKAQKAAGKIHSDIERG
FIAAEVINYDDYIKVKSMTKAKEQGLIRLEGKDYIVKDGDIIYFRFNV
>Mature_367_residues
PLSCGIVGLPNVGKSTLFNALIKAAKAQAANYPFCTIEPNIGTVEVPDERLYEIARLENSAKVVPTFIEFVDIAGLVRGA
SKGEGLGNQFLSHIRNVDAIVQVVRCFEDENITHVEGSVNPIRDIEIIDLELIAKDLESVQKTIQKIEKIAKGGNQEAKQ
ELEYLKKFEEILNPMIPLRRANLTEEEKEYAKNKLFLLSIKPTMFVANLSEEEIQGPTSNKHYRNLLEYAEKENAPVIPV
CAKLESEMIDMSKEEVQEMLNLYGLKETGLSSIIKSGYKLLGLITFFTAGPKESRAWAIAKDTKAQKAAGKIHSDIERGF
IAAEVINYDDYIKVKSMTKAKEQGLIRLEGKDYIVKDGDIIYFRFNV

Specific function: GTP-dependent nucleic acid-binding protein which may act as a translation factor [H]

COG id: COG0012

COG function: function code J; Predicted GTPase, probable translation factor

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 G (guanine nucleotide-binding) domain [H]

Homologues:

Organism=Homo sapiens, GI58761500, Length=370, Percent_Identity=46.2162162162162, Blast_Score=307, Evalue=1e-83,
Organism=Homo sapiens, GI58761502, Length=228, Percent_Identity=39.4736842105263, Blast_Score=146, Evalue=3e-35,
Organism=Escherichia coli, GI1787454, Length=368, Percent_Identity=52.445652173913, Blast_Score=377, Evalue=1e-106,
Organism=Escherichia coli, GI1789574, Length=137, Percent_Identity=32.1167883211679, Blast_Score=75, Evalue=6e-15,
Organism=Caenorhabditis elegans, GI17509631, Length=368, Percent_Identity=43.2065217391304, Blast_Score=290, Evalue=6e-79,
Organism=Caenorhabditis elegans, GI17552324, Length=188, Percent_Identity=28.1914893617021, Blast_Score=69, Evalue=5e-12,
Organism=Saccharomyces cerevisiae, GI6319499, Length=372, Percent_Identity=43.5483870967742, Blast_Score=279, Evalue=6e-76,
Organism=Saccharomyces cerevisiae, GI6321773, Length=393, Percent_Identity=39.440203562341, Blast_Score=237, Evalue=2e-63,
Organism=Saccharomyces cerevisiae, GI6321649, Length=143, Percent_Identity=37.7622377622378, Blast_Score=79, Evalue=2e-15,
Organism=Drosophila melanogaster, GI24640873, Length=370, Percent_Identity=44.3243243243243, Blast_Score=292, Evalue=3e-79,
Organism=Drosophila melanogaster, GI24640877, Length=370, Percent_Identity=44.3243243243243, Blast_Score=292, Evalue=3e-79,
Organism=Drosophila melanogaster, GI24640875, Length=370, Percent_Identity=44.3243243243243, Blast_Score=292, Evalue=3e-79,
Organism=Drosophila melanogaster, GI24640879, Length=329, Percent_Identity=42.2492401215805, Blast_Score=241, Evalue=6e-64,
Organism=Drosophila melanogaster, GI24585318, Length=103, Percent_Identity=39.8058252427184, Blast_Score=72, Evalue=7e-13,
Organism=Drosophila melanogaster, GI20129375, Length=121, Percent_Identity=35.5371900826446, Blast_Score=69, Evalue=4e-12,

Paralogues:

None

Copy number: 120 Molecules/Cell In: Growth Phase, Minimal Media (Based on E. coli). 140 Molecules/Cell In: Growth Phase, Minimal Media (Based on E. coli). [C]

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR012675
- InterPro:   IPR004396
- InterPro:   IPR013029
- InterPro:   IPR006073
- InterPro:   IPR002917
- InterPro:   IPR012676
- InterPro:   IPR023192 [H]

Pfam domain/function: PF01926 MMR_HSR1; PF06071 YchF-GTPase_C [H]

EC number: NA

Molecular weight: Translated: 41190; Mature: 41059

Theoretical pI: Translated: 5.26; Mature: 5.26

Prosite motif: PS00443 GATASE_TYPE_II

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.1 %Cys     (Translated Protein)
1.9 %Met     (Translated Protein)
3.0 %Cys+Met (Translated Protein)
1.1 %Cys     (Mature Protein)
1.6 %Met     (Mature Protein)
2.7 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MPLSCGIVGLPNVGKSTLFNALIKAAKAQAANYPFCTIEPNIGTVEVPDERLYEIARLEN
CCCCCCEEECCCCCHHHHHHHHHHHHHHHCCCCCEEEECCCCCEEECCHHHHHHHHHHCC
SAKVVPTFIEFVDIAGLVRGASKGEGLGNQFLSHIRNVDAIVQVVRCFEDENITHVEGSV
CCCHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHHHCCCCCEEECCCC
NPIRDIEIIDLELIAKDLESVQKTIQKIEKIAKGGNQEAKQELEYLKKFEEILNPMIPLR
CCCCCEEEHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHCCHH
RANLTEEEKEYAKNKLFLLSIKPTMFVANLSEEEIQGPTSNKHYRNLLEYAEKENAPVIP
HCCCCHHHHHHHHCCEEEEEECCEEEEECCCHHHCCCCCCCHHHHHHHHHHHHCCCCEEH
VCAKLESEMIDMSKEEVQEMLNLYGLKETGLSSIIKSGYKLLGLITFFTAGPKESRAWAI
HHHHHHHHHHCCCHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCEEE
AKDTKAQKAAGKIHSDIERGFIAAEVINYDDYIKVKSMTKAKEQGLIRLEGKDYIVKDGD
ECCCHHHHHHHHHHHHHHHHHHHHHHCCCCCCEEHHHHHHHHHCCEEEECCCEEEEECCC
IIYFRFNV
EEEEEECC
>Mature Secondary Structure 
PLSCGIVGLPNVGKSTLFNALIKAAKAQAANYPFCTIEPNIGTVEVPDERLYEIARLEN
CCCCCEEECCCCCHHHHHHHHHHHHHHHCCCCCEEEECCCCCEEECCHHHHHHHHHHCC
SAKVVPTFIEFVDIAGLVRGASKGEGLGNQFLSHIRNVDAIVQVVRCFEDENITHVEGSV
CCCHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHHHCCCCCEEECCCC
NPIRDIEIIDLELIAKDLESVQKTIQKIEKIAKGGNQEAKQELEYLKKFEEILNPMIPLR
CCCCCEEEHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHCCHH
RANLTEEEKEYAKNKLFLLSIKPTMFVANLSEEEIQGPTSNKHYRNLLEYAEKENAPVIP
HCCCCHHHHHHHHCCEEEEEECCEEEEECCCHHHCCCCCCCHHHHHHHHHHHHCCCCEEH
VCAKLESEMIDMSKEEVQEMLNLYGLKETGLSSIIKSGYKLLGLITFFTAGPKESRAWAI
HHHHHHHHHHCCCHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCEEE
AKDTKAQKAAGKIHSDIERGFIAAEVINYDDYIKVKSMTKAKEQGLIRLEGKDYIVKDGD
ECCCHHHHHHHHHHHHHHHHHHHHHHCCCCCCEEHHHHHHHHHCCEEEECCCEEEEECCC
IIYFRFNV
EEEEEECC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 7584024; 9384377 [H]