Definition Ralstonia eutropha JMP134 chromosome 1, complete sequence.
Accession NC_007347
Length 3,806,533

Click here to switch to the map view.

The map label for this gene is ydiU [C]

Identifier: 73541090

GI number: 73541090

Start: 1509192

End: 1510754

Strand: Reverse

Name: ydiU [C]

Synonym: Reut_A1396

Alternate gene names: 73541090

Gene position: 1510754-1509192 (Counterclockwise)

Preceding gene: 73541098

Following gene: 73541089

Centisome position: 39.69

GC content: 67.43

Gene sequence:

>1563_bases
ATGTCCGATACCCATCCTTCTCAGACCACCCCGCGCGACGCCGCCGATAGCGTTGCAACGCTGAGCGCGCCCTTCCCGAC
CATGCCCGGCTTCGCCGAACTGGGCGAGCGCTTCTTCACGCGGCTGCGTCCCACGCCATTGCCATCGGCCTATCTGGTCA
GCGTGGCACCGAACGCTGCGGCGCTGCTTGGCATGCCGGTAGAGGCAGCGTCAGAGCCGGACTTCATTGAGGCCTTTGTG
GGCAACAGCGTCCCTGACTGGGCCGACCCGCTGGCCACCGTGTATTCGGGGCACCAGTTCGGCGTCTGGGCCGGTCAGCT
CGGCGACGGGCGCGCGATCCGGCTGGCGCAGGCGCAGACCGATACCGGCCCGTGGGAAATCCAGCTCAAGGGCGCCGGGC
TGACGCCCTATTCGCGCATGGCGGACGGCCGCGCGGTGCTGCGCTCGTCGATCCGCGAATACCTGTGCTCGGAAGCCATG
GCAGCGCTCGGCGTACCGACCACGCGCGCGCTGAGCATCATCGGCTCGGATGCGCCTGTGCGGCGCGAGACCATCGAGAC
TGCCGCCGTGGTCACACGGCTGGCGCCCACCTTTATCCGCTTCGGGCACTTCGAACACTTCGCCGCACATGAAGACGTGG
CGGCCCTGCGCCAGCTTGCCGACTTCGTCATCAACAATTTCATGCCGGCCTGCCGCGAAGCGGCCCAGCCGTACCAGGCG
CTTCTGCGCGAGGTGTCGCTGCGTACCGCCGACATGGTCGCGCACTGGCAGGCGATCGGCTTCTGCCACGGCGTGATGAA
TACCGACAATATGTCGATCCTCGGGCTGACCATCGACTATGGTCCGTTCGGCTTCCTTGACGCGTTCGACGCCAACCACA
TCTGCAACCACTCGGACACGCAGGGCCGCTACGCCTACAGCCAGCAGCCGCAGGTCGCGTTCTGGAATCTGCATTGCCTG
GCCCAGGCGCTGCTGCCGCTATGGCTGGAGCCCGGTGCCGACGAGGCCGCGCGTGACGGCGCCGTGGCGCAGGCGCGCGA
AGCGCTGGACCCGTTCCGCGATCGCTACGCGAGCGAGTTTTTCCGCCACTACCGCGCAAAACTGGGCATTCACATGCCCG
CGGGCGGCGACAAGGAAGACGAGCCGCTGCTGACGAGCCTGTTCCAGCTCTTGCACGAGCAGCACGTCGACTACACCTTG
TTTTGGCGCAACCTCGCCCGCATCTCGTCCGCAGATGGCTCGGGCGATGCGCCGGTGCGCGATCTGTTCCTGGACCGTGC
CGCGTGGGACACCTGGGCGGAAAGCTACCGGAACCGCCTGCGCGCGGAGCAGTCCGATGATGCAGCCCGGCGCGTCGCCA
TGCTGGCGGTGAATCCCAAGTATGTGCTGCGCAACCACCTTGCGGAGATCGCCATCCGGCGCGCGCGCGAAAAGGACTTC
AGCGAAGTGGACCGCCTGCTGGCCGTGCTGTCGCGCCCGTTCGACGAACAGCCGGAGGCCGAAGCCTACGCCGCGCTGCC
GCCTGACTGGGCGGGCGGCCTGGAAGTGAGCTGTTCGTCCTGA

Upstream 100 bases:

>100_bases
AAGCGCACTTCGGGGCGCTGCGGCATGCCGGCGCTGCACTGCCACGCGCGCCATCGCTTGCCAGCCCTGAATCCATCGCC
ACGCGGCTCGCCCCCAGACA

Downstream 100 bases:

>100_bases
TCATCGCCTTGCACGCGCCGGCACACTTGCCGGCGCTGATGTAAGGTTCGGGCCACGGCCGCGACCAATGCGTGAGGCCG
GCAGGAACGCCAGCCCCCTA

Product: hypothetical protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 520; Mature: 519

Protein sequence:

>520_residues
MSDTHPSQTTPRDAADSVATLSAPFPTMPGFAELGERFFTRLRPTPLPSAYLVSVAPNAAALLGMPVEAASEPDFIEAFV
GNSVPDWADPLATVYSGHQFGVWAGQLGDGRAIRLAQAQTDTGPWEIQLKGAGLTPYSRMADGRAVLRSSIREYLCSEAM
AALGVPTTRALSIIGSDAPVRRETIETAAVVTRLAPTFIRFGHFEHFAAHEDVAALRQLADFVINNFMPACREAAQPYQA
LLREVSLRTADMVAHWQAIGFCHGVMNTDNMSILGLTIDYGPFGFLDAFDANHICNHSDTQGRYAYSQQPQVAFWNLHCL
AQALLPLWLEPGADEAARDGAVAQAREALDPFRDRYASEFFRHYRAKLGIHMPAGGDKEDEPLLTSLFQLLHEQHVDYTL
FWRNLARISSADGSGDAPVRDLFLDRAAWDTWAESYRNRLRAEQSDDAARRVAMLAVNPKYVLRNHLAEIAIRRAREKDF
SEVDRLLAVLSRPFDEQPEAEAYAALPPDWAGGLEVSCSS

Sequences:

>Translated_520_residues
MSDTHPSQTTPRDAADSVATLSAPFPTMPGFAELGERFFTRLRPTPLPSAYLVSVAPNAAALLGMPVEAASEPDFIEAFV
GNSVPDWADPLATVYSGHQFGVWAGQLGDGRAIRLAQAQTDTGPWEIQLKGAGLTPYSRMADGRAVLRSSIREYLCSEAM
AALGVPTTRALSIIGSDAPVRRETIETAAVVTRLAPTFIRFGHFEHFAAHEDVAALRQLADFVINNFMPACREAAQPYQA
LLREVSLRTADMVAHWQAIGFCHGVMNTDNMSILGLTIDYGPFGFLDAFDANHICNHSDTQGRYAYSQQPQVAFWNLHCL
AQALLPLWLEPGADEAARDGAVAQAREALDPFRDRYASEFFRHYRAKLGIHMPAGGDKEDEPLLTSLFQLLHEQHVDYTL
FWRNLARISSADGSGDAPVRDLFLDRAAWDTWAESYRNRLRAEQSDDAARRVAMLAVNPKYVLRNHLAEIAIRRAREKDF
SEVDRLLAVLSRPFDEQPEAEAYAALPPDWAGGLEVSCSS
>Mature_519_residues
SDTHPSQTTPRDAADSVATLSAPFPTMPGFAELGERFFTRLRPTPLPSAYLVSVAPNAAALLGMPVEAASEPDFIEAFVG
NSVPDWADPLATVYSGHQFGVWAGQLGDGRAIRLAQAQTDTGPWEIQLKGAGLTPYSRMADGRAVLRSSIREYLCSEAMA
ALGVPTTRALSIIGSDAPVRRETIETAAVVTRLAPTFIRFGHFEHFAAHEDVAALRQLADFVINNFMPACREAAQPYQAL
LREVSLRTADMVAHWQAIGFCHGVMNTDNMSILGLTIDYGPFGFLDAFDANHICNHSDTQGRYAYSQQPQVAFWNLHCLA
QALLPLWLEPGADEAARDGAVAQAREALDPFRDRYASEFFRHYRAKLGIHMPAGGDKEDEPLLTSLFQLLHEQHVDYTLF
WRNLARISSADGSGDAPVRDLFLDRAAWDTWAESYRNRLRAEQSDDAARRVAMLAVNPKYVLRNHLAEIAIRRAREKDFS
EVDRLLAVLSRPFDEQPEAEAYAALPPDWAGGLEVSCSS

Specific function: Unknown

COG id: COG0397

COG function: function code S; Uncharacterized conserved protein

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the UPF0061 (SELO) family

Homologues:

Organism=Homo sapiens, GI32880229, Length=409, Percent_Identity=47.6772616136919, Blast_Score=309, Evalue=4e-84,
Organism=Escherichia coli, GI1787999, Length=483, Percent_Identity=47.4120082815735, Blast_Score=411, Evalue=1e-116,
Organism=Saccharomyces cerevisiae, GI6325034, Length=282, Percent_Identity=41.8439716312057, Blast_Score=216, Evalue=7e-57,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): Y1396_CUPPJ (Q472B7)

Other databases:

- EMBL:   CP000090
- RefSeq:   YP_295610.1
- GeneID:   3610302
- GenomeReviews:   CP000090_GR
- KEGG:   reu:Reut_A1396
- NMPDR:   fig|264198.3.peg.1962
- HOGENOM:   HBG683993
- OMA:   FGSYNPR
- ProtClustDB:   PRK00029
- BioCyc:   REUT264198:REUT_A1396-MONOMER
- HAMAP:   MF_00692
- InterPro:   IPR003846

Pfam domain/function: PF02696 UPF0061

EC number: NA

Molecular weight: Translated: 57332; Mature: 57201

Theoretical pI: Translated: 5.04; Mature: 5.04

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.2 %Cys     (Translated Protein)
2.1 %Met     (Translated Protein)
3.3 %Cys+Met (Translated Protein)
1.2 %Cys     (Mature Protein)
1.9 %Met     (Mature Protein)
3.1 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSDTHPSQTTPRDAADSVATLSAPFPTMPGFAELGERFFTRLRPTPLPSAYLVSVAPNAA
CCCCCCCCCCCCHHHHHHHCCCCCCCCCCCHHHHHHHHHHHCCCCCCCCCEEEEECCCCH
ALLGMPVEAASEPDFIEAFVGNSVPDWADPLATVYSGHQFGVWAGQLGDGRAIRLAQAQT
HHCCCCHHCCCCCHHHHHHHCCCCCCHHHHHHHHHCCCEECEEECCCCCCCEEEEEECCC
DTGPWEIQLKGAGLTPYSRMADGRAVLRSSIREYLCSEAMAALGVPTTRALSIIGSDAPV
CCCCEEEEEECCCCCHHHHHCCHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHCCCCCH
RRETIETAAVVTRLAPTFIRFGHFEHFAAHEDVAALRQLADFVINNFMPACREAAQPYQA
HHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHH
LLREVSLRTADMVAHWQAIGFCHGVMNTDNMSILGLTIDYGPFGFLDAFDANHICNHSDT
HHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCEEEEEEECCCCCCCHHCCCCCCCCCCCCC
QGRYAYSQQPQVAFWNLHCLAQALLPLWLEPGADEAARDGAVAQAREALDPFRDRYASEF
CCCEEECCCCCEEEHHHHHHHHHHHHHHCCCCCCHHHHCCHHHHHHHHHHHHHHHHHHHH
FRHYRAKLGIHMPAGGDKEDEPLLTSLFQLLHEQHVDYTLFWRNLARISSADGSGDAPVR
HHHHHHHCCEECCCCCCCCCCHHHHHHHHHHHHHCCCHHHHHHHHHHHHCCCCCCCCHHH
DLFLDRAAWDTWAESYRNRLRAEQSDDAARRVAMLAVNPKYVLRNHLAEIAIRRAREKDF
HHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHEEHEECCHHHHHHHHHHHHHHHHHHCCCH
SEVDRLLAVLSRPFDEQPEAEAYAALPPDWAGGLEVSCSS
HHHHHHHHHHHCCCCCCCCCCEEECCCCCCCCCEEEEECC
>Mature Secondary Structure 
SDTHPSQTTPRDAADSVATLSAPFPTMPGFAELGERFFTRLRPTPLPSAYLVSVAPNAA
CCCCCCCCCCCHHHHHHHCCCCCCCCCCCHHHHHHHHHHHCCCCCCCCCEEEEECCCCH
ALLGMPVEAASEPDFIEAFVGNSVPDWADPLATVYSGHQFGVWAGQLGDGRAIRLAQAQT
HHCCCCHHCCCCCHHHHHHHCCCCCCHHHHHHHHHCCCEECEEECCCCCCCEEEEEECCC
DTGPWEIQLKGAGLTPYSRMADGRAVLRSSIREYLCSEAMAALGVPTTRALSIIGSDAPV
CCCCEEEEEECCCCCHHHHHCCHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHCCCCCH
RRETIETAAVVTRLAPTFIRFGHFEHFAAHEDVAALRQLADFVINNFMPACREAAQPYQA
HHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHH
LLREVSLRTADMVAHWQAIGFCHGVMNTDNMSILGLTIDYGPFGFLDAFDANHICNHSDT
HHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCEEEEEEECCCCCCCHHCCCCCCCCCCCCC
QGRYAYSQQPQVAFWNLHCLAQALLPLWLEPGADEAARDGAVAQAREALDPFRDRYASEF
CCCEEECCCCCEEEHHHHHHHHHHHHHHCCCCCCHHHHCCHHHHHHHHHHHHHHHHHHHH
FRHYRAKLGIHMPAGGDKEDEPLLTSLFQLLHEQHVDYTLFWRNLARISSADGSGDAPVR
HHHHHHHCCEECCCCCCCCCCHHHHHHHHHHHHHCCCHHHHHHHHHHHHCCCCCCCCHHH
DLFLDRAAWDTWAESYRNRLRAEQSDDAARRVAMLAVNPKYVLRNHLAEIAIRRAREKDF
HHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHEEHEECCHHHHHHHHHHHHHHHHHHCCCH
SEVDRLLAVLSRPFDEQPEAEAYAALPPDWAGGLEVSCSS
HHHHHHHHHHHCCCCCCCCCCEEECCCCCCCCCEEEEECC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA