Definition Eubacterium eligens ATCC 27750 chromosome, complete genome.
Accession NC_012778
Length 2,144,190

Click here to switch to the map view.

The map label for this gene is engA

Identifier: 238916971

GI number: 238916971

Start: 1053180

End: 1054505

Strand: Reverse

Name: engA

Synonym: EUBELI_01040

Alternate gene names: 238916971

Gene position: 1054505-1053180 (Counterclockwise)

Preceding gene: 238916973

Following gene: 238916970

Centisome position: 49.18

GC content: 36.73

Gene sequence:

>1326_bases
ATGAGTAAACCAATAGTTGCTGTTGTCGGAAGACCTAATGTTGGAAAATCAACATTATTCAACAGTCTGTGCGGACAACA
GATTTCAATAGTTAAAGATACACCGGGTGTTACAAGAGACAGAATTTATGCAGAGGTAAGCTGGTTAAACCACAATTTTA
CACTTATAGATACCGGTGGTATAGAGCCGGATACAGGTGATATTATCCTTTCGCAGATGCGTGAACAGGCTGAGATTGCC
ATTGAAACTGCGGATGTAATTATATTTATGACTGATGTTAAGCAGGGACTTGTAGATTCAGATTCTAAGGTTGCTGATAT
GTTAAGACGCTCACACAAGCCTGTTATTCTTGTTGTCAATAAAGTTGACAGCTTTGAGAAGATGATGCCTGATGTATATG
AATTCTATAATCTTGGAATTGGAGAACCATTTCCTATATCAGCCGTTAATAAGTTAGGTTTTGGTGAAGTACTTGATGAA
GTGGTAAGTCATTTCCCAGAGGGTTCAGATACTGATAAAGAAGATGACAGACCTAAGGTGGCTATAATAGGTAAGCCTAA
TGTTGGTAAGTCATCTATAATCAATAAGCTTGTAGGCAAGAACAGAGTTATTGTATCTGATATTGCCGGTACAACAAGAG
ATGCTATTGACACAGCTATCAAATATAATGGTAAAGAATATGTATTTATTGATACAGCGGGACTACGCCGTAAGAGTAAG
ATTAAAGAAGATCTGGAGCGTTTTAGTATCATAAGAACTGTTGCAGCAGTTGAAAGAGCTGATATTGCAATTCTTGTTAT
TGATGCTACGGAAGGTGTTACAGAGCAGGATGCCAAGATAGCCGGAATAGCGCATGAAAGAGGCAAGGGTATTATTATTG
CTGTTAACAAATGGGATGATATAGAGAAGAATGACAAGACTATCTATGAGTTTACGAATAAGATTAAAGATACTCTTGCA
TTTATGTCATATGCTGAGATTATATTTGTTTCTGCCAAGACAGGTCAGAGACTTAATAAAATATATGAATTAGTTGATCA
CATTGTTGATGCACAGACTATGCGTATTCCTACCGGTGTGCTTAATGAAATTCTTACAGAAGCAGTTGCAATGAAGCAGC
CACCTTCAGATAAGGGTAAGAGACTTAAAATCTATTACATGACTCAGGTTTCGGTAAAACCACCGACATTTGTTATGTTT
GTTAATGATGTAGCACTCACACATTTTTCTTATACAAGATATATAGAAAACAGAATAAGAGAATCCTTTGGATTCAGAGG
TACATCTATCAGATTCATCAACAGAGAACGTAAGGAGAAAGAGTAA

Upstream 100 bases:

>100_bases
TGATATCACAGTGCTTTACAAAAAGCAATTAAACTGATATTATATTATAGATTGCGTGTATTAATTTTTTGTAAATTTGC
TATAAGAGCAAGGAGGAATT

Downstream 100 bases:

>100_bases
TGTTATTTAAAATAGGTGTTCTTATATATGGATATTTTGCCGGAGCACTCATTCAGGCAGGATACTGGATGGGAAAGTTC
AATAAGATTGACATCAGGGA

Product: GTP-binding protein EngA

Products: NA

Alternate protein names: GTP-binding protein EngA

Number of amino acids: Translated: 441; Mature: 440

Protein sequence:

>441_residues
MSKPIVAVVGRPNVGKSTLFNSLCGQQISIVKDTPGVTRDRIYAEVSWLNHNFTLIDTGGIEPDTGDIILSQMREQAEIA
IETADVIIFMTDVKQGLVDSDSKVADMLRRSHKPVILVVNKVDSFEKMMPDVYEFYNLGIGEPFPISAVNKLGFGEVLDE
VVSHFPEGSDTDKEDDRPKVAIIGKPNVGKSSIINKLVGKNRVIVSDIAGTTRDAIDTAIKYNGKEYVFIDTAGLRRKSK
IKEDLERFSIIRTVAAVERADIAILVIDATEGVTEQDAKIAGIAHERGKGIIIAVNKWDDIEKNDKTIYEFTNKIKDTLA
FMSYAEIIFVSAKTGQRLNKIYELVDHIVDAQTMRIPTGVLNEILTEAVAMKQPPSDKGKRLKIYYMTQVSVKPPTFVMF
VNDVALTHFSYTRYIENRIRESFGFRGTSIRFINRERKEKE

Sequences:

>Translated_441_residues
MSKPIVAVVGRPNVGKSTLFNSLCGQQISIVKDTPGVTRDRIYAEVSWLNHNFTLIDTGGIEPDTGDIILSQMREQAEIA
IETADVIIFMTDVKQGLVDSDSKVADMLRRSHKPVILVVNKVDSFEKMMPDVYEFYNLGIGEPFPISAVNKLGFGEVLDE
VVSHFPEGSDTDKEDDRPKVAIIGKPNVGKSSIINKLVGKNRVIVSDIAGTTRDAIDTAIKYNGKEYVFIDTAGLRRKSK
IKEDLERFSIIRTVAAVERADIAILVIDATEGVTEQDAKIAGIAHERGKGIIIAVNKWDDIEKNDKTIYEFTNKIKDTLA
FMSYAEIIFVSAKTGQRLNKIYELVDHIVDAQTMRIPTGVLNEILTEAVAMKQPPSDKGKRLKIYYMTQVSVKPPTFVMF
VNDVALTHFSYTRYIENRIRESFGFRGTSIRFINRERKEKE
>Mature_440_residues
SKPIVAVVGRPNVGKSTLFNSLCGQQISIVKDTPGVTRDRIYAEVSWLNHNFTLIDTGGIEPDTGDIILSQMREQAEIAI
ETADVIIFMTDVKQGLVDSDSKVADMLRRSHKPVILVVNKVDSFEKMMPDVYEFYNLGIGEPFPISAVNKLGFGEVLDEV
VSHFPEGSDTDKEDDRPKVAIIGKPNVGKSSIINKLVGKNRVIVSDIAGTTRDAIDTAIKYNGKEYVFIDTAGLRRKSKI
KEDLERFSIIRTVAAVERADIAILVIDATEGVTEQDAKIAGIAHERGKGIIIAVNKWDDIEKNDKTIYEFTNKIKDTLAF
MSYAEIIFVSAKTGQRLNKIYELVDHIVDAQTMRIPTGVLNEILTEAVAMKQPPSDKGKRLKIYYMTQVSVKPPTFVMFV
NDVALTHFSYTRYIENRIRESFGFRGTSIRFINRERKEKE

Specific function: GTPase that plays an essential role in the late steps of ribosome biogenesis

COG id: COG1160

COG function: function code R; Predicted GTPases

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 KH-like domain

Homologues:

Organism=Escherichia coli, GI87082120, Length=467, Percent_Identity=38.7580299785867, Blast_Score=321, Evalue=6e-89,
Organism=Escherichia coli, GI1788919, Length=179, Percent_Identity=33.5195530726257, Blast_Score=82, Evalue=8e-17,
Organism=Escherichia coli, GI2367268, Length=92, Percent_Identity=45.6521739130435, Blast_Score=80, Evalue=4e-16,
Organism=Caenorhabditis elegans, GI17507259, Length=136, Percent_Identity=36.0294117647059, Blast_Score=69, Evalue=6e-12,
Organism=Saccharomyces cerevisiae, GI6323665, Length=163, Percent_Identity=37.4233128834356, Blast_Score=83, Evalue=7e-17,
Organism=Drosophila melanogaster, GI45550813, Length=110, Percent_Identity=37.2727272727273, Blast_Score=72, Evalue=1e-12,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): DER_EUBE2 (C4Z0C8)

Other databases:

- EMBL:   CP001104
- RefSeq:   YP_002930488.1
- GeneID:   7958454
- GenomeReviews:   CP001104_GR
- KEGG:   eel:EUBELI_01040
- OMA:   KCEKAFD
- ProtClustDB:   PRK00093
- GO:   GO:0005622
- HAMAP:   MF_00195
- InterPro:   IPR003593
- InterPro:   IPR016484
- InterPro:   IPR006073
- InterPro:   IPR015946
- InterPro:   IPR002917
- InterPro:   IPR005225
- Gene3D:   G3DSA:3.30.300.20
- PIRSF:   PIRSF006485
- PRINTS:   PR00326
- SMART:   SM00382
- TIGRFAMs:   TIGR03594
- TIGRFAMs:   TIGR00231

Pfam domain/function: PF01926 MMR_HSR1

EC number: NA

Molecular weight: Translated: 49402; Mature: 49271

Theoretical pI: Translated: 6.82; Mature: 6.82

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.2 %Cys     (Translated Protein)
2.5 %Met     (Translated Protein)
2.7 %Cys+Met (Translated Protein)
0.2 %Cys     (Mature Protein)
2.3 %Met     (Mature Protein)
2.5 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSKPIVAVVGRPNVGKSTLFNSLCGQQISIVKDTPGVTRDRIYAEVSWLNHNFTLIDTGG
CCCCEEEEECCCCCCHHHHHHHHCCCEEEEEECCCCCCHHHEEEEEEEECCCEEEEECCC
IEPDTGDIILSQMREQAEIAIETADVIIFMTDVKQGLVDSDSKVADMLRRSHKPVILVVN
CCCCCHHHHHHHHHHHHHEEEEECCEEEEEECHHHCCCCCCHHHHHHHHHCCCCEEEEEE
KVDSFEKMMPDVYEFYNLGIGEPFPISAVNKLGFGEVLDEVVSHFPEGSDTDKEDDRPKV
CCCHHHHHHHHHHHHHHCCCCCCCCHHHHHHCCHHHHHHHHHHHCCCCCCCCCCCCCCCE
AIIGKPNVGKSSIINKLVGKNRVIVSDIAGTTRDAIDTAIKYNGKEYVFIDTAGLRRKSK
EEEECCCCCHHHHHHHHHCCCCEEEECCCCCHHHHHHHHHEECCCEEEEEECCCCCHHHH
IKEDLERFSIIRTVAAVERADIAILVIDATEGVTEQDAKIAGIAHERGKGIIIAVNKWDD
HHHHHHHHHHHHHHHHHHHCCEEEEEEECCCCCCCCCCEEEEEEECCCCEEEEEEECCCC
IEKNDKTIYEFTNKIKDTLAFMSYAEIIFVSAKTGQRLNKIYELVDHIVDAQTMRIPTGV
CCCCCCHHHHHHHHHHHHHHHHHHEEEEEEECCCCHHHHHHHHHHHHHHCCHHEECCHHH
LNEILTEAVAMKQPPSDKGKRLKIYYMTQVSVKPPTFVMFVNDVALTHFSYTRYIENRIR
HHHHHHHHHHHCCCCCCCCCEEEEEEEEEEECCCCEEEEEECCHHHHHHHHHHHHHHHHH
ESFGFRGTSIRFINRERKEKE
HHHCCCCCEEEEECCCCCCCC
>Mature Secondary Structure 
SKPIVAVVGRPNVGKSTLFNSLCGQQISIVKDTPGVTRDRIYAEVSWLNHNFTLIDTGG
CCCEEEEECCCCCCHHHHHHHHCCCEEEEEECCCCCCHHHEEEEEEEECCCEEEEECCC
IEPDTGDIILSQMREQAEIAIETADVIIFMTDVKQGLVDSDSKVADMLRRSHKPVILVVN
CCCCCHHHHHHHHHHHHHEEEEECCEEEEEECHHHCCCCCCHHHHHHHHHCCCCEEEEEE
KVDSFEKMMPDVYEFYNLGIGEPFPISAVNKLGFGEVLDEVVSHFPEGSDTDKEDDRPKV
CCCHHHHHHHHHHHHHHCCCCCCCCHHHHHHCCHHHHHHHHHHHCCCCCCCCCCCCCCCE
AIIGKPNVGKSSIINKLVGKNRVIVSDIAGTTRDAIDTAIKYNGKEYVFIDTAGLRRKSK
EEEECCCCCHHHHHHHHHCCCCEEEECCCCCHHHHHHHHHEECCCEEEEEECCCCCHHHH
IKEDLERFSIIRTVAAVERADIAILVIDATEGVTEQDAKIAGIAHERGKGIIIAVNKWDD
HHHHHHHHHHHHHHHHHHHCCEEEEEEECCCCCCCCCCEEEEEEECCCCEEEEEEECCCC
IEKNDKTIYEFTNKIKDTLAFMSYAEIIFVSAKTGQRLNKIYELVDHIVDAQTMRIPTGV
CCCCCCHHHHHHHHHHHHHHHHHHEEEEEEECCCCHHHHHHHHHHHHHHCCHHEECCHHH
LNEILTEAVAMKQPPSDKGKRLKIYYMTQVSVKPPTFVMFVNDVALTHFSYTRYIENRIR
HHHHHHHHHHHCCCCCCCCCEEEEEEEEEEECCCCEEEEEECCHHHHHHHHHHHHHHHHH
ESFGFRGTSIRFINRERKEKE
HHHCCCCCEEEEECCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA