Definition Eubacterium rectale ATCC 33656, complete genome.
Accession NC_012781
Length 3,449,685

Click here to switch to the map view.

The map label for this gene is yfmM [H]

Identifier: 238924083

GI number: 238924083

Start: 1602347

End: 1603900

Strand: Direct

Name: yfmM [H]

Synonym: EUBREC_1721

Alternate gene names: 238924083

Gene position: 1602347-1603900 (Clockwise)

Preceding gene: 238924082

Following gene: 238924084

Centisome position: 46.45

GC content: 45.82

Gene sequence:

>1554_bases
ATGAGTATTTTAAACGTAGAGCACCTAAGCCATGGTTTTGGCGACCGTGCTATTTTTGAGGATGTTTCCTTCAGACTGTT
GAAGGGAGAGCACATAGGGCTTGTCGGTGCAAACGGTGAGGGAAAATCGACTTTTATGAATATTATCACAGGCAGGCTTA
TGCCTGATGAGGGCAAAATAGAGTGGGCAAAGAAGGTGCGTGTGGGTTATCTAGACCAGCACACAGCGCTTGAAAAGGGT
ATGACTATCGGCTCAGTTCTTTCATCTGCATTTGATTTCCTTTATGATATGGAAAATGAGATGAACGACATATATGCGCG
TCTTGGCGATGTGGACGAGGACGAGATGAATAAGCTGATGGAGGAAGCCGGCACGATTCAGGACATGCTTACCATGCATG
ATTTCTATATGATTGATGCAAAGGTTGAGGAGGTTGCAAGGGCTCTTGGACTTTTAGACCTGGGGCTTGATAAAGACGTT
ACCGATTTAAGCGGTGGTCAGAGAACCAAAGTGCTGATGGGAAAGCTCCTCTTGGAGAAGCCGGATATTCTGCTTTTGGA
TGAGCCTACAAACTATCTGGACGTAGAGCATATTGAGTGGCTTAAGCGATATCTGAACGATTATGAGAATGCGTTTATTC
TTATTTCTCACGATATACCGTTTCTGAACAGCGTGGTAAATCTCATCTATCACATGGACAACAAGAAGCTCGACAGGTAT
GTCGGGGATTATGACAAATTTATGGAAGTCTATGAGATGAAGAAAGCCCAGCTTGAGGCTGCGTACAACAAACAGCAGCA
GGAGATTAAAGAGCTGAAGGATTTTGTGGCGAGAAATAAGGCGCGTGTCGCTACAAGGAATATGGCGATGTCACGTCAGA
AGAAGCTTGACAAGATGGATGTTATTGAGCTTGCTGCTGAAAAGCCAAAGCCGGAGTTTAACTTTAAGACAGCGCGTACT
CCGGGTCGGTATATTTTCCAGACAAATGGACTGGTCATTGGCTATGATGATCCGCTTTCATCTGCTCTCGACCTTGAGAT
GGAGAGGGGACAAAAGATTGTTCTTACCGGTGCAAACGGCATCGGAAAGACGACATTGCTTAAGAGTATTCTTGGGCTGA
TAAAGCCGCTTTCAGGAAGTGTTACACTTGGAGATTATCTGGAGATAGGGTACTTTGAGCAGGAGATGGATCAGTCGGTT
ACAACCACATGTATTGAGGAGATATGGAACGAGTTTCCTGCATTTTCGCAGTACGAGGTGCGAAGCGCGCTTGCCAAGTG
TGGTCTGACCACAAAGCATATTGAAAGCCAGGTGCGTGTGTTAAGCGGTGGTGAACAGGCAAAGGTACGCCTGTGCAAGC
TGATAAACAGAGAGACAAATATTCTGCTTCTGGATGAGCCTACCAACCATCTGGATGTGGATGCTAAGGATGAGCTGAAG
CGTGCCTTAAAGGAATATAAGGGCAGCATACTGATGGTATGCCACGAGCCGGATTTCTATGATGGGCTTGCGACGGATGT
GTGGGATTGTTCAAAGTGGACTACGAGATTATAG

Upstream 100 bases:

>100_bases
GAGCTTGCTGACTAAATCTTGAAGAAAGTGCCATATTGGGAAAATAAAATCTTGAAGAAAATGCCATATTGGGGAAATAA
AATCTTGAAGAGAGGTATAC

Downstream 100 bases:

>100_bases
ATTTATAAATTATGAATTAGATATGCATGCCTTTTAAGACATAGATATTTAGAGCAGGAGATGATTTTTATGCATATCAG
TATACTTTTAATGGAACAGA

Product: YdiF

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 517; Mature: 516

Protein sequence:

>517_residues
MSILNVEHLSHGFGDRAIFEDVSFRLLKGEHIGLVGANGEGKSTFMNIITGRLMPDEGKIEWAKKVRVGYLDQHTALEKG
MTIGSVLSSAFDFLYDMENEMNDIYARLGDVDEDEMNKLMEEAGTIQDMLTMHDFYMIDAKVEEVARALGLLDLGLDKDV
TDLSGGQRTKVLMGKLLLEKPDILLLDEPTNYLDVEHIEWLKRYLNDYENAFILISHDIPFLNSVVNLIYHMDNKKLDRY
VGDYDKFMEVYEMKKAQLEAAYNKQQQEIKELKDFVARNKARVATRNMAMSRQKKLDKMDVIELAAEKPKPEFNFKTART
PGRYIFQTNGLVIGYDDPLSSALDLEMERGQKIVLTGANGIGKTTLLKSILGLIKPLSGSVTLGDYLEIGYFEQEMDQSV
TTTCIEEIWNEFPAFSQYEVRSALAKCGLTTKHIESQVRVLSGGEQAKVRLCKLINRETNILLLDEPTNHLDVDAKDELK
RALKEYKGSILMVCHEPDFYDGLATDVWDCSKWTTRL

Sequences:

>Translated_517_residues
MSILNVEHLSHGFGDRAIFEDVSFRLLKGEHIGLVGANGEGKSTFMNIITGRLMPDEGKIEWAKKVRVGYLDQHTALEKG
MTIGSVLSSAFDFLYDMENEMNDIYARLGDVDEDEMNKLMEEAGTIQDMLTMHDFYMIDAKVEEVARALGLLDLGLDKDV
TDLSGGQRTKVLMGKLLLEKPDILLLDEPTNYLDVEHIEWLKRYLNDYENAFILISHDIPFLNSVVNLIYHMDNKKLDRY
VGDYDKFMEVYEMKKAQLEAAYNKQQQEIKELKDFVARNKARVATRNMAMSRQKKLDKMDVIELAAEKPKPEFNFKTART
PGRYIFQTNGLVIGYDDPLSSALDLEMERGQKIVLTGANGIGKTTLLKSILGLIKPLSGSVTLGDYLEIGYFEQEMDQSV
TTTCIEEIWNEFPAFSQYEVRSALAKCGLTTKHIESQVRVLSGGEQAKVRLCKLINRETNILLLDEPTNHLDVDAKDELK
RALKEYKGSILMVCHEPDFYDGLATDVWDCSKWTTRL
>Mature_516_residues
SILNVEHLSHGFGDRAIFEDVSFRLLKGEHIGLVGANGEGKSTFMNIITGRLMPDEGKIEWAKKVRVGYLDQHTALEKGM
TIGSVLSSAFDFLYDMENEMNDIYARLGDVDEDEMNKLMEEAGTIQDMLTMHDFYMIDAKVEEVARALGLLDLGLDKDVT
DLSGGQRTKVLMGKLLLEKPDILLLDEPTNYLDVEHIEWLKRYLNDYENAFILISHDIPFLNSVVNLIYHMDNKKLDRYV
GDYDKFMEVYEMKKAQLEAAYNKQQQEIKELKDFVARNKARVATRNMAMSRQKKLDKMDVIELAAEKPKPEFNFKTARTP
GRYIFQTNGLVIGYDDPLSSALDLEMERGQKIVLTGANGIGKTTLLKSILGLIKPLSGSVTLGDYLEIGYFEQEMDQSVT
TTCIEEIWNEFPAFSQYEVRSALAKCGLTTKHIESQVRVLSGGEQAKVRLCKLINRETNILLLDEPTNHLDVDAKDELKR
ALKEYKGSILMVCHEPDFYDGLATDVWDCSKWTTRL

Specific function: Unknown

COG id: COG0488

COG function: function code R; ATPase components of ABC transporters with duplicated ATPase domains

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 2 ABC transporter domains [H]

Homologues:

Organism=Homo sapiens, GI148612853, Length=522, Percent_Identity=27.5862068965517, Blast_Score=210, Evalue=3e-54,
Organism=Homo sapiens, GI10947137, Length=524, Percent_Identity=28.8167938931298, Blast_Score=200, Evalue=3e-51,
Organism=Homo sapiens, GI27881506, Length=524, Percent_Identity=28.8167938931298, Blast_Score=199, Evalue=4e-51,
Organism=Homo sapiens, GI10947135, Length=521, Percent_Identity=28.2149712092131, Blast_Score=179, Evalue=5e-45,
Organism=Homo sapiens, GI69354671, Length=523, Percent_Identity=28.2982791586998, Blast_Score=179, Evalue=5e-45,
Organism=Escherichia coli, GI1787041, Length=505, Percent_Identity=33.0693069306931, Blast_Score=276, Evalue=2e-75,
Organism=Escherichia coli, GI1789751, Length=498, Percent_Identity=29.1164658634538, Blast_Score=253, Evalue=2e-68,
Organism=Escherichia coli, GI2367384, Length=507, Percent_Identity=31.163708086785, Blast_Score=241, Evalue=9e-65,
Organism=Escherichia coli, GI1787182, Length=529, Percent_Identity=30.2457466918715, Blast_Score=224, Evalue=8e-60,
Organism=Escherichia coli, GI1788165, Length=292, Percent_Identity=25.3424657534247, Blast_Score=92, Evalue=7e-20,
Organism=Escherichia coli, GI1788225, Length=197, Percent_Identity=31.4720812182741, Blast_Score=77, Evalue=2e-15,
Organism=Escherichia coli, GI48994883, Length=263, Percent_Identity=25.8555133079848, Blast_Score=69, Evalue=6e-13,
Organism=Escherichia coli, GI1789593, Length=234, Percent_Identity=24.3589743589744, Blast_Score=65, Evalue=8e-12,
Organism=Escherichia coli, GI1790525, Length=240, Percent_Identity=24.5833333333333, Blast_Score=64, Evalue=2e-11,
Organism=Caenorhabditis elegans, GI17555318, Length=518, Percent_Identity=29.5366795366795, Blast_Score=218, Evalue=5e-57,
Organism=Caenorhabditis elegans, GI17559834, Length=522, Percent_Identity=27.5862068965517, Blast_Score=198, Evalue=7e-51,
Organism=Caenorhabditis elegans, GI17553372, Length=518, Percent_Identity=28.1853281853282, Blast_Score=197, Evalue=8e-51,
Organism=Saccharomyces cerevisiae, GI6321121, Length=526, Percent_Identity=31.3688212927757, Blast_Score=236, Evalue=6e-63,
Organism=Saccharomyces cerevisiae, GI6320874, Length=528, Percent_Identity=30.6818181818182, Blast_Score=207, Evalue=4e-54,
Organism=Saccharomyces cerevisiae, GI6325030, Length=410, Percent_Identity=26.8292682926829, Blast_Score=115, Evalue=2e-26,
Organism=Saccharomyces cerevisiae, GI6324314, Length=402, Percent_Identity=26.3681592039801, Blast_Score=108, Evalue=3e-24,
Organism=Saccharomyces cerevisiae, GI6323278, Length=392, Percent_Identity=23.9795918367347, Blast_Score=100, Evalue=5e-22,
Organism=Drosophila melanogaster, GI24666836, Length=527, Percent_Identity=29.0322580645161, Blast_Score=228, Evalue=7e-60,
Organism=Drosophila melanogaster, GI24642252, Length=536, Percent_Identity=27.9850746268657, Blast_Score=207, Evalue=1e-53,
Organism=Drosophila melanogaster, GI18859989, Length=536, Percent_Identity=27.9850746268657, Blast_Score=207, Evalue=1e-53,
Organism=Drosophila melanogaster, GI24641342, Length=496, Percent_Identity=28.0241935483871, Blast_Score=195, Evalue=5e-50,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR003439
- InterPro:   IPR017871
- InterPro:   IPR003593 [H]

Pfam domain/function: PF00005 ABC_tran [H]

EC number: NA

Molecular weight: Translated: 58812; Mature: 58681

Theoretical pI: Translated: 4.79; Mature: 4.79

Prosite motif: PS00211 ABC_TRANSPORTER_1 ; PS50893 ABC_TRANSPORTER_2

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.0 %Cys     (Translated Protein)
4.1 %Met     (Translated Protein)
5.0 %Cys+Met (Translated Protein)
1.0 %Cys     (Mature Protein)
3.9 %Met     (Mature Protein)
4.8 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSILNVEHLSHGFGDRAIFEDVSFRLLKGEHIGLVGANGEGKSTFMNIITGRLMPDEGKI
CCCEEHHHHHCCCCCHHHHHHHHHEEECCCEEEEEECCCCCHHHHHHHHHCCCCCCCCCH
EWAKKVRVGYLDQHTALEKGMTIGSVLSSAFDFLYDMENEMNDIYARLGDVDEDEMNKLM
HHHHHHHHCCCCHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHH
EEAGTIQDMLTMHDFYMIDAKVEEVARALGLLDLGLDKDVTDLSGGQRTKVLMGKLLLEK
HHHHHHHHHHHHHHHHEEHHHHHHHHHHHHHHHCCCCCCCHHCCCCCHHHHHHHHHHHCC
PDILLLDEPTNYLDVEHIEWLKRYLNDYENAFILISHDIPFLNSVVNLIYHMDNKKLDRY
CCEEEEECCCCCCCHHHHHHHHHHHHCCCCEEEEEECCCHHHHHHHHHHHHCCCHHHHHH
VGDYDKFMEVYEMKKAQLEAAYNKQQQEIKELKDFVARNKARVATRNMAMSRQKKLDKMD
HCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHCCHHH
VIELAAEKPKPEFNFKTARTPGRYIFQTNGLVIGYDDPLSSALDLEMERGQKIVLTGANG
HHHHHHCCCCCCCCCEECCCCCCEEEEECCEEEECCCCCCHHHHHHHHCCCEEEEECCCC
IGKTTLLKSILGLIKPLSGSVTLGDYLEIGYFEQEMDQSVTTTCIEEIWNEFPAFSQYEV
CCHHHHHHHHHHHHCCCCCCEEECCHHHCCCHHHHHHHHHHHHHHHHHHHHCCCCCHHHH
RSALAKCGLTTKHIESQVRVLSGGEQAKVRLCKLINRETNILLLDEPTNHLDVDAKDELK
HHHHHHCCCCHHHHHHHHHHHCCCHHHHHHHHHHHCCCCCEEEEECCCCCCCCCCHHHHH
RALKEYKGSILMVCHEPDFYDGLATDVWDCSKWTTRL
HHHHHHCCCEEEEEECCCCCCCCHHHHHCCCHHHCCC
>Mature Secondary Structure 
SILNVEHLSHGFGDRAIFEDVSFRLLKGEHIGLVGANGEGKSTFMNIITGRLMPDEGKI
CCEEHHHHHCCCCCHHHHHHHHHEEECCCEEEEEECCCCCHHHHHHHHHCCCCCCCCCH
EWAKKVRVGYLDQHTALEKGMTIGSVLSSAFDFLYDMENEMNDIYARLGDVDEDEMNKLM
HHHHHHHHCCCCHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHH
EEAGTIQDMLTMHDFYMIDAKVEEVARALGLLDLGLDKDVTDLSGGQRTKVLMGKLLLEK
HHHHHHHHHHHHHHHHEEHHHHHHHHHHHHHHHCCCCCCCHHCCCCCHHHHHHHHHHHCC
PDILLLDEPTNYLDVEHIEWLKRYLNDYENAFILISHDIPFLNSVVNLIYHMDNKKLDRY
CCEEEEECCCCCCCHHHHHHHHHHHHCCCCEEEEEECCCHHHHHHHHHHHHCCCHHHHHH
VGDYDKFMEVYEMKKAQLEAAYNKQQQEIKELKDFVARNKARVATRNMAMSRQKKLDKMD
HCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHCCHHH
VIELAAEKPKPEFNFKTARTPGRYIFQTNGLVIGYDDPLSSALDLEMERGQKIVLTGANG
HHHHHHCCCCCCCCCEECCCCCCEEEEECCEEEECCCCCCHHHHHHHHCCCEEEEECCCC
IGKTTLLKSILGLIKPLSGSVTLGDYLEIGYFEQEMDQSVTTTCIEEIWNEFPAFSQYEV
CCHHHHHHHHHHHHCCCCCCEEECCHHHCCCHHHHHHHHHHHHHHHHHHHHCCCCCHHHH
RSALAKCGLTTKHIESQVRVLSGGEQAKVRLCKLINRETNILLLDEPTNHLDVDAKDELK
HHHHHHCCCCHHHHHHHHHHHCCCHHHHHHHHHHHCCCCCEEEEECCCCCCCCCCHHHHH
RALKEYKGSILMVCHEPDFYDGLATDVWDCSKWTTRL
HHHHHHCCCEEEEEECCCCCCCCHHHHHCCCHHHCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 9272861; 9384377 [H]