Definition Corynebacterium diphtheriae NCTC 13129 chromosome, complete genome.
Accession NC_002935
Length 2,488,635

Click here to switch to the map view.

The map label for this gene is yidE [C]

Identifier: 38233427

GI number: 38233427

Start: 805625

End: 807250

Strand: Reverse

Name: yidE [C]

Synonym: DIP0830

Alternate gene names: 38233427

Gene position: 807250-805625 (Counterclockwise)

Preceding gene: 38233429

Following gene: 38233425

Centisome position: 32.44

GC content: 51.78

Gene sequence:

>1626_bases
GTGGATATCTTCGTGGCAAACCCGCTGTTGGCGCTTTTTGTCATCATGGCGGTTGGATTAGCGATCGGTCAGGTTAAAAT
CCGAGGTTTTAGTCTCGGAGTGGCAGCAGTGCTTTTTGCAGGCGTTGGATTTGCGGCTGTAGAGCCTGATATTCACATCC
CACACTTGGTGTACATCTTGGGATTGTCTATTTTTGTGTACTCCATCGGTTTGGAATCAGGCCATGCGTTTTTCGCCCTG
TTTAAGTCGCAAGGAGTCAAACAAAACGCGCTCGCTATTACCGCGTTGGCGCTGATAACAGGCATTTCTATCGCTTTGTT
TTCGCTGATACATCTCAACGGGGTCACCGCTGCTGGGTTGTTTACAGGCGCGGTAACAAATACACCGGCCATGGCTGCCG
TGGTGGATTCGTTACCCAGCATCTTTGGGGATGCGAACAAGGTACACGAGGTGGAATCGTTGCCCTTAGTTGCATATTCG
CTGGCCTACCCCATCGGCGTATTGGGAGTTATCGCGGCAATTGGGTTGTGTGCAAAGTGGTTCCGTATCGATCACGTGCA
AGAAGCTCACGACGCAGGTGTTGCTGTTGAGGATTTGTTCACCCGTCAGATCAAGGTCAATCATGTGGTTACGGGCTCTG
ATCTTGTGATTGATATCCACCACACGCTGGGCCTAGAGATTATTGTCTCGCGAATTGAGCGTGATGGTCAGCAGACTCTC
CCTACTGCGTCGTCTCGTATCCATATGGGAGATGTGTTGTCTGTGGTGGGCACGGCCGAGGAACTCGACAAGGCCGCGCA
TGTGCTAGGTGATTTGCTCCCAGGCGATCCTTTCCATGGTCACGATTTAGATTATCGGCGCATTTTTGTTTCCAATCAGG
ATTTAGTGGGCATACCTCTGGCTAAACTTCGGCCTCGATTGTCAGGAATTTTGATTACTCGGGTCCGTCGTGGCGACCAT
GACCATGTGGCTACTCCGGAAACAGTTTTGCAGCTTGGCGACCGTGTTCGGGTGGTGGCAGCTCATGATCGTATGAAATC
CGTGACGGCACTGTTCGGCGATTCCTATCGTCGCCTTTCTGATTTCAATCTTTTCCCTCTCGTTGCCGGGCTTGCGCTTG
GATTGCTCGTTGGCATGATTGAGGTACCACTTCCTGGCGGTGCTGCGTTGTCTTTAGGAAGCGCCGGCGGCCCATTAGTA
GTAGCTCTCGTTCTAGGCGCAGTGGGACGCTCAGGTCGTTTTGTGTGGCAGGTTCCTTACGGAGCAAACTTGGCACTGCG
ACAACTAGGCATCACCTTGTTTCTCGCCGCTATTGGTACCACTGCAGGAGCTAGTTTCCGTGCATCGCTATCAGATCCCG
CATCGTTGACCATCATTGCCGTTGGTGCCATCATCACCTTGACATTGGCTATCTTTGTTCTGGTTGTGGGCTATAAGGTG
ATGAAGATCCCGTACGGCCAAACAGCGGGCATGCTTGCGGGTATTCAAACGCACCCAGCTGTACTGTCCTATGTTTCTGC
GATGACGAAAAATGATCTGCCGGCATTGGGCTACACCTCGGTATATCCACTGGCCATGATCGCTAAGATCATTGCAGCAC
AGGTTGTGCTATTCGCTTTGACATAG

Upstream 100 bases:

>100_bases
ATGCACCGTTGCAAGCGTTTCCTCACGGGGTGCTACCCCCGTTTTGGCCACATTGGCATTTATTACCAATATGTTTTCAA
TTTCTGGCACGATCGACATT

Downstream 100 bases:

>100_bases
TGGGCACCACCAGATGATTCTTTCGAGTTCGGTGGTGGGGTCGTCGACAAGCGTGCTTTTGCGTATGAGGGTGCCGCAGC
GTCTGCACGGCTTATGATTG

Product: hypothetical protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 541; Mature: 541

Protein sequence:

>541_residues
MDIFVANPLLALFVIMAVGLAIGQVKIRGFSLGVAAVLFAGVGFAAVEPDIHIPHLVYILGLSIFVYSIGLESGHAFFAL
FKSQGVKQNALAITALALITGISIALFSLIHLNGVTAAGLFTGAVTNTPAMAAVVDSLPSIFGDANKVHEVESLPLVAYS
LAYPIGVLGVIAAIGLCAKWFRIDHVQEAHDAGVAVEDLFTRQIKVNHVVTGSDLVIDIHHTLGLEIIVSRIERDGQQTL
PTASSRIHMGDVLSVVGTAEELDKAAHVLGDLLPGDPFHGHDLDYRRIFVSNQDLVGIPLAKLRPRLSGILITRVRRGDH
DHVATPETVLQLGDRVRVVAAHDRMKSVTALFGDSYRRLSDFNLFPLVAGLALGLLVGMIEVPLPGGAALSLGSAGGPLV
VALVLGAVGRSGRFVWQVPYGANLALRQLGITLFLAAIGTTAGASFRASLSDPASLTIIAVGAIITLTLAIFVLVVGYKV
MKIPYGQTAGMLAGIQTHPAVLSYVSAMTKNDLPALGYTSVYPLAMIAKIIAAQVVLFALT

Sequences:

>Translated_541_residues
MDIFVANPLLALFVIMAVGLAIGQVKIRGFSLGVAAVLFAGVGFAAVEPDIHIPHLVYILGLSIFVYSIGLESGHAFFAL
FKSQGVKQNALAITALALITGISIALFSLIHLNGVTAAGLFTGAVTNTPAMAAVVDSLPSIFGDANKVHEVESLPLVAYS
LAYPIGVLGVIAAIGLCAKWFRIDHVQEAHDAGVAVEDLFTRQIKVNHVVTGSDLVIDIHHTLGLEIIVSRIERDGQQTL
PTASSRIHMGDVLSVVGTAEELDKAAHVLGDLLPGDPFHGHDLDYRRIFVSNQDLVGIPLAKLRPRLSGILITRVRRGDH
DHVATPETVLQLGDRVRVVAAHDRMKSVTALFGDSYRRLSDFNLFPLVAGLALGLLVGMIEVPLPGGAALSLGSAGGPLV
VALVLGAVGRSGRFVWQVPYGANLALRQLGITLFLAAIGTTAGASFRASLSDPASLTIIAVGAIITLTLAIFVLVVGYKV
MKIPYGQTAGMLAGIQTHPAVLSYVSAMTKNDLPALGYTSVYPLAMIAKIIAAQVVLFALT
>Mature_541_residues
MDIFVANPLLALFVIMAVGLAIGQVKIRGFSLGVAAVLFAGVGFAAVEPDIHIPHLVYILGLSIFVYSIGLESGHAFFAL
FKSQGVKQNALAITALALITGISIALFSLIHLNGVTAAGLFTGAVTNTPAMAAVVDSLPSIFGDANKVHEVESLPLVAYS
LAYPIGVLGVIAAIGLCAKWFRIDHVQEAHDAGVAVEDLFTRQIKVNHVVTGSDLVIDIHHTLGLEIIVSRIERDGQQTL
PTASSRIHMGDVLSVVGTAEELDKAAHVLGDLLPGDPFHGHDLDYRRIFVSNQDLVGIPLAKLRPRLSGILITRVRRGDH
DHVATPETVLQLGDRVRVVAAHDRMKSVTALFGDSYRRLSDFNLFPLVAGLALGLLVGMIEVPLPGGAALSLGSAGGPLV
VALVLGAVGRSGRFVWQVPYGANLALRQLGITLFLAAIGTTAGASFRASLSDPASLTIIAVGAIITLTLAIFVLVVGYKV
MKIPYGQTAGMLAGIQTHPAVLSYVSAMTKNDLPALGYTSVYPLAMIAKIIAAQVVLFALT

Specific function: Unknown

COG id: COG2985

COG function: function code R; Predicted permease

Gene ontology:

Cell location: Cell membrane; Multi-pass membrane protein (Potential)

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 2 RCK C-terminal domains

Homologues:

Organism=Escherichia coli, GI87082315, Length=554, Percent_Identity=32.8519855595668, Blast_Score=236, Evalue=3e-63,
Organism=Escherichia coli, GI1787071, Length=562, Percent_Identity=24.5551601423488, Blast_Score=128, Evalue=9e-31,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): Y830_CORDI (Q6NIE7)

Other databases:

- EMBL:   BX248356
- RefSeq:   NP_939194.1
- ProteinModelPortal:   Q6NIE7
- GeneID:   2649292
- GenomeReviews:   BX248353_GR
- KEGG:   cdi:DIP0830
- NMPDR:   fig|257309.1.peg.785
- HOGENOM:   HBG452396
- OMA:   RIMSPQL
- PhylomeDB:   Q6NIE7
- ProtClustDB:   CLSK633680
- BioCyc:   CDIP257309:DIP0830-MONOMER
- InterPro:   IPR006037
- InterPro:   IPR006512
- TIGRFAMs:   TIGR01625

Pfam domain/function: PF06826 Asp-Al_Ex; PF02080 TrkA_C

EC number: NA

Molecular weight: Translated: 56824; Mature: 56824

Theoretical pI: Translated: 7.37; Mature: 7.37

Prosite motif: PS51202 RCK_C

Important sites: NA

Signals:

None

Transmembrane regions:

HASH(0xc4b25b0)-; HASH(0x116746e8)-; HASH(0x11677058)-; HASH(0x114ec3a8)-; HASH(0x114f6314)-; HASH(0x114e6b34)-; HASH(0x11676fe0)-; HASH(0x116761ac)-; HASH(0x114ddaa4)-; HASH(0x1166b5ec)-;

Cys/Met content:

0.2 %Cys     (Translated Protein)
1.8 %Met     (Translated Protein)
2.0 %Cys+Met (Translated Protein)
0.2 %Cys     (Mature Protein)
1.8 %Met     (Mature Protein)
2.0 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MDIFVANPLLALFVIMAVGLAIGQVKIRGFSLGVAAVLFAGVGFAAVEPDIHIPHLVYIL
CCEEECCHHHHHHHHHHHHHHHCEEEEEEEHHHHHHHHHHCCCCEEECCCCCCHHHHHHH
GLSIFVYSIGLESGHAFFALFKSQGVKQNALAITALALITGISIALFSLIHLNGVTAAGL
HHHHHHHHHCCCCCCCEEEEEHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHH
FTGAVTNTPAMAAVVDSLPSIFGDANKVHEVESLPLVAYSLAYPIGVLGVIAAIGLCAKW
HHCCCCCCCHHHHHHHHHHHHHCCCHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHH
FRIDHVQEAHDAGVAVEDLFTRQIKVNHVVTGSDLVIDIHHTLGLEIIVSRIERDGQQTL
HHHHHHHHHHHCCCCHHHHHHHHEEEEEEEECCCEEEEEHHHHHHHHHHHHHHCCCCCCC
PTASSRIHMGDVLSVVGTAEELDKAAHVLGDLLPGDPFHGHDLDYRRIFVSNQDLVGIPL
CCCCCCEEHHHHHHHHCCHHHHHHHHHHHHHCCCCCCCCCCCCCEEEEEECCCCEECCCH
AKLRPRLSGILITRVRRGDHDHVATPETVLQLGDRVRVVAAHDRMKSVTALFGDSYRRLS
HHHCHHHHHEEEEEECCCCCCCCCCHHHHHHCCCCEEEEEHHHHHHHHHHHHCCHHHHHC
DFNLFPLVAGLALGLLVGMIEVPLPGGAALSLGSAGGPLVVALVLGAVGRSGRFVWQVPY
CCCHHHHHHHHHHHHHHHHHHCCCCCCCEEECCCCCCHHHHHHHHHHCCCCCCEEEECCC
GANLALRQLGITLFLAAIGTTAGASFRASLSDPASLTIIAVGAIITLTLAIFVLVVGYKV
CCCHHHHHHHHHHHHHHHHCCCCCCEEECCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHH
MKIPYGQTAGMLAGIQTHPAVLSYVSAMTKNDLPALGYTSVYPLAMIAKIIAAQVVLFAL
EECCCCCCCHHHCCCCCCHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHHHHCC
T
H
>Mature Secondary Structure
MDIFVANPLLALFVIMAVGLAIGQVKIRGFSLGVAAVLFAGVGFAAVEPDIHIPHLVYIL
CCEEECCHHHHHHHHHHHHHHHCEEEEEEEHHHHHHHHHHCCCCEEECCCCCCHHHHHHH
GLSIFVYSIGLESGHAFFALFKSQGVKQNALAITALALITGISIALFSLIHLNGVTAAGL
HHHHHHHHHCCCCCCCEEEEEHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHH
FTGAVTNTPAMAAVVDSLPSIFGDANKVHEVESLPLVAYSLAYPIGVLGVIAAIGLCAKW
HHCCCCCCCHHHHHHHHHHHHHCCCHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHH
FRIDHVQEAHDAGVAVEDLFTRQIKVNHVVTGSDLVIDIHHTLGLEIIVSRIERDGQQTL
HHHHHHHHHHHCCCCHHHHHHHHEEEEEEEECCCEEEEEHHHHHHHHHHHHHHCCCCCCC
PTASSRIHMGDVLSVVGTAEELDKAAHVLGDLLPGDPFHGHDLDYRRIFVSNQDLVGIPL
CCCCCCEEHHHHHHHHCCHHHHHHHHHHHHHCCCCCCCCCCCCCEEEEEECCCCEECCCH
AKLRPRLSGILITRVRRGDHDHVATPETVLQLGDRVRVVAAHDRMKSVTALFGDSYRRLS
HHHCHHHHHEEEEEECCCCCCCCCCHHHHHHCCCCEEEEEHHHHHHHHHHHHCCHHHHHC
DFNLFPLVAGLALGLLVGMIEVPLPGGAALSLGSAGGPLVVALVLGAVGRSGRFVWQVPY
CCCHHHHHHHHHHHHHHHHHHCCCCCCCEEECCCCCCHHHHHHHHHHCCCCCCEEEECCC
GANLALRQLGITLFLAAIGTTAGASFRASLSDPASLTIIAVGAIITLTLAIFVLVVGYKV
CCCHHHHHHHHHHHHHHHHCCCCCCEEECCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHH
MKIPYGQTAGMLAGIQTHPAVLSYVSAMTKNDLPALGYTSVYPLAMIAKIIAAQVVLFAL
EECCCCCCCHHHCCCCCCHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHHHHCC
T
H

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 14602910