Definition Vibrio cholerae M66-2 chromosome I, complete genome.
Accession NC_012578
Length 2,892,523

Click here to switch to the map view.

The map label for this gene is yegM [C]

Identifier: 227080398

GI number: 227080398

Start: 162793

End: 163899

Strand: Reverse

Name: yegM [C]

Synonym: VCM66_0164

Alternate gene names: 227080398

Gene position: 163899-162793 (Counterclockwise)

Preceding gene: 227080399

Following gene: 227080397

Centisome position: 5.67

GC content: 47.24

Gene sequence:

>1107_bases
ATGAAAAAGTGGACATTTTTTATGTTGCTTATCGCGATCCTGCTGTTTGGCAGCGTGATAGGTTTCAATCTTTTCAAACA
ACAGAAAATTGCCGAGTACCTCGCCAATCGTCCTGAGCCAGAATTTCCGGTTACCGTAGTGACCGCCAATCCGGTTGATT
GGGTACCCGTGATTGAAGCGATCGGTTTTATTGAGCCGAATCAAGGTGTGACATTAACGACCGAAACGGCAGGGGTGATT
GACCAAATTACGTTTGAATCGGGCACGCAAGTCGCAAAAGACCAACCTCTAGTGCTACTGGATTCAGCGGTAGAACGAGC
CAATTTAAAAAGCACTGAAGCGCGCCTGCCTGCAGCGAAAGCCAAATATGAACGCTACAAGGGTCTGTTCGCTAAAGGTT
CTATCTCTAAAGAGTCTTATGATGAAGCAGAAGCGAGCTACTATGCGCTCTCCGCTGATATTGAAAGCCTAAAAGCCACC
ATTGCTCGCCGTGAAATCAAAGCGCCTTTTGCTGGTGTGATCGGTATTCGTAATGTGTTCTTAGGTCAATATTTGCAGCC
GGGTACAGACATTGTGCGCTTGGAAGATACCAGCGTGATGCGTCTGCGTTTTACCGTGCCACAAAGAGATATTTCGCGTA
TTTCACTGGATCAAGAAGTCGATATTTTTGTGGATGCTTATCCACAGACTTCATTTAAAGGCTCCATCTCGGCAATTGAA
CCTGCTGTAAGCGTACAAAGCGGCCTGATCCAAGTACAAGCGGATATCCCAAATAGTGATGGCAAACTGCGAAGCGGCAT
GTTTGCGCGTGCCAACATCATTCTGCCTAAGCTGGAAAACCAAGTCACTCTGCCGCAAACCGCGATTACCTATACCCTCT
ACGGTGACAATGTTTACATTGTCAGCGAAGAAAATGGTGAGAAGCGCGTCCAGCAACATGTTGTGAAAGTGGGTGAGCGC
TCTGAATCTATTGCTCACATTCTGGAAGGCGTAAAACCGGGTGATGTGGTTGTCACGACAGGTCAAGTACGTCTGAGTAA
CGGTGCTAAAGTTCGTATCGTCGAAAGTGATGCGACTACACCACCAGCAGAAACCCCAATGCTGTAA

Upstream 100 bases:

>100_bases
CGCTTTAGGTTTTTATCAACTGGATGATTCAACTCTCGATGCAATGATTCAAGCCAGTTGGGATGCAATTACTCAACACT
AATTTGGAGTTCGCACCAGA

Downstream 100 bases:

>100_bases
GCGGAGGCATCATGCGCTTTACTGATGTTTTTATAAAACGTCCAGTTTTAGCGGTATCGATCAGCTTTTTGATTGTGTTG
CTTGGTCTACAAGCCATTTT

Product: hypothetical protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 368; Mature: 368

Protein sequence:

>368_residues
MKKWTFFMLLIAILLFGSVIGFNLFKQQKIAEYLANRPEPEFPVTVVTANPVDWVPVIEAIGFIEPNQGVTLTTETAGVI
DQITFESGTQVAKDQPLVLLDSAVERANLKSTEARLPAAKAKYERYKGLFAKGSISKESYDEAEASYYALSADIESLKAT
IARREIKAPFAGVIGIRNVFLGQYLQPGTDIVRLEDTSVMRLRFTVPQRDISRISLDQEVDIFVDAYPQTSFKGSISAIE
PAVSVQSGLIQVQADIPNSDGKLRSGMFARANIILPKLENQVTLPQTAITYTLYGDNVYIVSEENGEKRVQQHVVKVGER
SESIAHILEGVKPGDVVVTTGQVRLSNGAKVRIVESDATTPPAETPML

Sequences:

>Translated_368_residues
MKKWTFFMLLIAILLFGSVIGFNLFKQQKIAEYLANRPEPEFPVTVVTANPVDWVPVIEAIGFIEPNQGVTLTTETAGVI
DQITFESGTQVAKDQPLVLLDSAVERANLKSTEARLPAAKAKYERYKGLFAKGSISKESYDEAEASYYALSADIESLKAT
IARREIKAPFAGVIGIRNVFLGQYLQPGTDIVRLEDTSVMRLRFTVPQRDISRISLDQEVDIFVDAYPQTSFKGSISAIE
PAVSVQSGLIQVQADIPNSDGKLRSGMFARANIILPKLENQVTLPQTAITYTLYGDNVYIVSEENGEKRVQQHVVKVGER
SESIAHILEGVKPGDVVVTTGQVRLSNGAKVRIVESDATTPPAETPML
>Mature_368_residues
MKKWTFFMLLIAILLFGSVIGFNLFKQQKIAEYLANRPEPEFPVTVVTANPVDWVPVIEAIGFIEPNQGVTLTTETAGVI
DQITFESGTQVAKDQPLVLLDSAVERANLKSTEARLPAAKAKYERYKGLFAKGSISKESYDEAEASYYALSADIESLKAT
IARREIKAPFAGVIGIRNVFLGQYLQPGTDIVRLEDTSVMRLRFTVPQRDISRISLDQEVDIFVDAYPQTSFKGSISAIE
PAVSVQSGLIQVQADIPNSDGKLRSGMFARANIILPKLENQVTLPQTAITYTLYGDNVYIVSEENGEKRVQQHVVKVGER
SESIAHILEGVKPGDVVVTTGQVRLSNGAKVRIVESDATTPPAETPML

Specific function: Unknown

COG id: COG0845

COG function: function code M; Membrane-fusion protein

Gene ontology:

Cell location: Membrane; Single-pass membrane protein (Potential) [H]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the membrane fusion protein (MFP) (TC 8.A.1) family [H]

Homologues:

Organism=Escherichia coli, GI87082036, Length=350, Percent_Identity=27.4285714285714, Blast_Score=110, Evalue=2e-25,
Organism=Escherichia coli, GI87081796, Length=337, Percent_Identity=27.0029673590504, Blast_Score=87, Evalue=1e-18,
Organism=Escherichia coli, GI1789665, Length=393, Percent_Identity=25.1908396946565, Blast_Score=79, Evalue=5e-16,
Organism=Escherichia coli, GI1789929, Length=388, Percent_Identity=22.1649484536082, Blast_Score=69, Evalue=6e-13,
Organism=Escherichia coli, GI1786668, Length=312, Percent_Identity=25, Blast_Score=65, Evalue=1e-11,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR006143 [H]

Pfam domain/function: PF00529 HlyD [H]

EC number: NA

Molecular weight: Translated: 40394; Mature: 40394

Theoretical pI: Translated: 5.03; Mature: 5.03

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.0 %Cys     (Translated Protein)
1.4 %Met     (Translated Protein)
1.4 %Cys+Met (Translated Protein)
0.0 %Cys     (Mature Protein)
1.4 %Met     (Mature Protein)
1.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKKWTFFMLLIAILLFGSVIGFNLFKQQKIAEYLANRPEPEFPVTVVTANPVDWVPVIEA
CCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCEEEEECCCCCHHHHHHH
IGFIEPNQGVTLTTETAGVIDQITFESGTQVAKDQPLVLLDSAVERANLKSTEARLPAAK
HCCCCCCCCEEEEECCCCCHHEEECCCCCCCCCCCCEEEEEHHHHHCCCCCHHHHCCHHH
AKYERYKGLFAKGSISKESYDEAEASYYALSADIESLKATIARREIKAPFAGVIGIRNVF
HHHHHHHCEEECCCCCCCCCCHHHHEEEEEHHHHHHHHHHHHHHHHCCCHHHHHHHHHHH
LGQYLQPGTDIVRLEDTSVMRLRFTVPQRDISRISLDQEVDIFVDAYPQTSFKGSISAIE
HHHHCCCCCCEEEEECCEEEEEEEECCCHHHHHCCCCCCEEEEEECCCCCCCCCCHHHHC
PAVSVQSGLIQVQADIPNSDGKLRSGMFARANIILPKLENQVTLPQTAITYTLYGDNVYI
CHHHHCCCEEEEEECCCCCCCCHHCCCEEEEEEEEECCCCCEECCCEEEEEEEECCEEEE
VSEENGEKRVQQHVVKVGERSESIAHILEGVKPGDVVVTTGQVRLSNGAKVRIVESDATT
EECCCCHHHHHHHHHHHCCCHHHHHHHHCCCCCCCEEEEECEEEECCCCEEEEEECCCCC
PPAETPML
CCCCCCCC
>Mature Secondary Structure
MKKWTFFMLLIAILLFGSVIGFNLFKQQKIAEYLANRPEPEFPVTVVTANPVDWVPVIEA
CCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCEEEEECCCCCHHHHHHH
IGFIEPNQGVTLTTETAGVIDQITFESGTQVAKDQPLVLLDSAVERANLKSTEARLPAAK
HCCCCCCCCEEEEECCCCCHHEEECCCCCCCCCCCCEEEEEHHHHHCCCCCHHHHCCHHH
AKYERYKGLFAKGSISKESYDEAEASYYALSADIESLKATIARREIKAPFAGVIGIRNVF
HHHHHHHCEEECCCCCCCCCCHHHHEEEEEHHHHHHHHHHHHHHHHCCCHHHHHHHHHHH
LGQYLQPGTDIVRLEDTSVMRLRFTVPQRDISRISLDQEVDIFVDAYPQTSFKGSISAIE
HHHHCCCCCCEEEEECCEEEEEEEECCCHHHHHCCCCCCEEEEEECCCCCCCCCCHHHHC
PAVSVQSGLIQVQADIPNSDGKLRSGMFARANIILPKLENQVTLPQTAITYTLYGDNVYI
CHHHHCCCEEEEEECCCCCCCCHHCCCEEEEEEEEECCCCCEECCCEEEEEEEECCEEEE
VSEENGEKRVQQHVVKVGERSESIAHILEGVKPGDVVVTTGQVRLSNGAKVRIVESDATT
EECCCCHHHHHHHHHHHCCCHHHHHHHHCCCCCCCEEEEECEEEECCCCEEEEEECCCCC
PPAETPML
CCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 7542800 [H]