| Definition | Corynebacterium diphtheriae NCTC 13129 chromosome, complete genome. |
|---|---|
| Accession | NC_002935 |
| Length | 2,488,635 |
Click here to switch to the map view.
The map label for this gene is yidE [C]
Identifier: 38233427
GI number: 38233427
Start: 805625
End: 807250
Strand: Reverse
Name: yidE [C]
Synonym: DIP0830
Alternate gene names: 38233427
Gene position: 807250-805625 (Counterclockwise)
Preceding gene: 38233429
Following gene: 38233425
Centisome position: 32.44
GC content: 51.78
Gene sequence:
>1626_bases GTGGATATCTTCGTGGCAAACCCGCTGTTGGCGCTTTTTGTCATCATGGCGGTTGGATTAGCGATCGGTCAGGTTAAAAT CCGAGGTTTTAGTCTCGGAGTGGCAGCAGTGCTTTTTGCAGGCGTTGGATTTGCGGCTGTAGAGCCTGATATTCACATCC CACACTTGGTGTACATCTTGGGATTGTCTATTTTTGTGTACTCCATCGGTTTGGAATCAGGCCATGCGTTTTTCGCCCTG TTTAAGTCGCAAGGAGTCAAACAAAACGCGCTCGCTATTACCGCGTTGGCGCTGATAACAGGCATTTCTATCGCTTTGTT TTCGCTGATACATCTCAACGGGGTCACCGCTGCTGGGTTGTTTACAGGCGCGGTAACAAATACACCGGCCATGGCTGCCG TGGTGGATTCGTTACCCAGCATCTTTGGGGATGCGAACAAGGTACACGAGGTGGAATCGTTGCCCTTAGTTGCATATTCG CTGGCCTACCCCATCGGCGTATTGGGAGTTATCGCGGCAATTGGGTTGTGTGCAAAGTGGTTCCGTATCGATCACGTGCA AGAAGCTCACGACGCAGGTGTTGCTGTTGAGGATTTGTTCACCCGTCAGATCAAGGTCAATCATGTGGTTACGGGCTCTG ATCTTGTGATTGATATCCACCACACGCTGGGCCTAGAGATTATTGTCTCGCGAATTGAGCGTGATGGTCAGCAGACTCTC CCTACTGCGTCGTCTCGTATCCATATGGGAGATGTGTTGTCTGTGGTGGGCACGGCCGAGGAACTCGACAAGGCCGCGCA TGTGCTAGGTGATTTGCTCCCAGGCGATCCTTTCCATGGTCACGATTTAGATTATCGGCGCATTTTTGTTTCCAATCAGG ATTTAGTGGGCATACCTCTGGCTAAACTTCGGCCTCGATTGTCAGGAATTTTGATTACTCGGGTCCGTCGTGGCGACCAT GACCATGTGGCTACTCCGGAAACAGTTTTGCAGCTTGGCGACCGTGTTCGGGTGGTGGCAGCTCATGATCGTATGAAATC CGTGACGGCACTGTTCGGCGATTCCTATCGTCGCCTTTCTGATTTCAATCTTTTCCCTCTCGTTGCCGGGCTTGCGCTTG GATTGCTCGTTGGCATGATTGAGGTACCACTTCCTGGCGGTGCTGCGTTGTCTTTAGGAAGCGCCGGCGGCCCATTAGTA GTAGCTCTCGTTCTAGGCGCAGTGGGACGCTCAGGTCGTTTTGTGTGGCAGGTTCCTTACGGAGCAAACTTGGCACTGCG ACAACTAGGCATCACCTTGTTTCTCGCCGCTATTGGTACCACTGCAGGAGCTAGTTTCCGTGCATCGCTATCAGATCCCG CATCGTTGACCATCATTGCCGTTGGTGCCATCATCACCTTGACATTGGCTATCTTTGTTCTGGTTGTGGGCTATAAGGTG ATGAAGATCCCGTACGGCCAAACAGCGGGCATGCTTGCGGGTATTCAAACGCACCCAGCTGTACTGTCCTATGTTTCTGC GATGACGAAAAATGATCTGCCGGCATTGGGCTACACCTCGGTATATCCACTGGCCATGATCGCTAAGATCATTGCAGCAC AGGTTGTGCTATTCGCTTTGACATAG
Upstream 100 bases:
>100_bases ATGCACCGTTGCAAGCGTTTCCTCACGGGGTGCTACCCCCGTTTTGGCCACATTGGCATTTATTACCAATATGTTTTCAA TTTCTGGCACGATCGACATT
Downstream 100 bases:
>100_bases TGGGCACCACCAGATGATTCTTTCGAGTTCGGTGGTGGGGTCGTCGACAAGCGTGCTTTTGCGTATGAGGGTGCCGCAGC GTCTGCACGGCTTATGATTG
Product: hypothetical protein
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 541; Mature: 541
Protein sequence:
>541_residues MDIFVANPLLALFVIMAVGLAIGQVKIRGFSLGVAAVLFAGVGFAAVEPDIHIPHLVYILGLSIFVYSIGLESGHAFFAL FKSQGVKQNALAITALALITGISIALFSLIHLNGVTAAGLFTGAVTNTPAMAAVVDSLPSIFGDANKVHEVESLPLVAYS LAYPIGVLGVIAAIGLCAKWFRIDHVQEAHDAGVAVEDLFTRQIKVNHVVTGSDLVIDIHHTLGLEIIVSRIERDGQQTL PTASSRIHMGDVLSVVGTAEELDKAAHVLGDLLPGDPFHGHDLDYRRIFVSNQDLVGIPLAKLRPRLSGILITRVRRGDH DHVATPETVLQLGDRVRVVAAHDRMKSVTALFGDSYRRLSDFNLFPLVAGLALGLLVGMIEVPLPGGAALSLGSAGGPLV VALVLGAVGRSGRFVWQVPYGANLALRQLGITLFLAAIGTTAGASFRASLSDPASLTIIAVGAIITLTLAIFVLVVGYKV MKIPYGQTAGMLAGIQTHPAVLSYVSAMTKNDLPALGYTSVYPLAMIAKIIAAQVVLFALT
Sequences:
>Translated_541_residues MDIFVANPLLALFVIMAVGLAIGQVKIRGFSLGVAAVLFAGVGFAAVEPDIHIPHLVYILGLSIFVYSIGLESGHAFFAL FKSQGVKQNALAITALALITGISIALFSLIHLNGVTAAGLFTGAVTNTPAMAAVVDSLPSIFGDANKVHEVESLPLVAYS LAYPIGVLGVIAAIGLCAKWFRIDHVQEAHDAGVAVEDLFTRQIKVNHVVTGSDLVIDIHHTLGLEIIVSRIERDGQQTL PTASSRIHMGDVLSVVGTAEELDKAAHVLGDLLPGDPFHGHDLDYRRIFVSNQDLVGIPLAKLRPRLSGILITRVRRGDH DHVATPETVLQLGDRVRVVAAHDRMKSVTALFGDSYRRLSDFNLFPLVAGLALGLLVGMIEVPLPGGAALSLGSAGGPLV VALVLGAVGRSGRFVWQVPYGANLALRQLGITLFLAAIGTTAGASFRASLSDPASLTIIAVGAIITLTLAIFVLVVGYKV MKIPYGQTAGMLAGIQTHPAVLSYVSAMTKNDLPALGYTSVYPLAMIAKIIAAQVVLFALT >Mature_541_residues MDIFVANPLLALFVIMAVGLAIGQVKIRGFSLGVAAVLFAGVGFAAVEPDIHIPHLVYILGLSIFVYSIGLESGHAFFAL FKSQGVKQNALAITALALITGISIALFSLIHLNGVTAAGLFTGAVTNTPAMAAVVDSLPSIFGDANKVHEVESLPLVAYS LAYPIGVLGVIAAIGLCAKWFRIDHVQEAHDAGVAVEDLFTRQIKVNHVVTGSDLVIDIHHTLGLEIIVSRIERDGQQTL PTASSRIHMGDVLSVVGTAEELDKAAHVLGDLLPGDPFHGHDLDYRRIFVSNQDLVGIPLAKLRPRLSGILITRVRRGDH DHVATPETVLQLGDRVRVVAAHDRMKSVTALFGDSYRRLSDFNLFPLVAGLALGLLVGMIEVPLPGGAALSLGSAGGPLV VALVLGAVGRSGRFVWQVPYGANLALRQLGITLFLAAIGTTAGASFRASLSDPASLTIIAVGAIITLTLAIFVLVVGYKV MKIPYGQTAGMLAGIQTHPAVLSYVSAMTKNDLPALGYTSVYPLAMIAKIIAAQVVLFALT
Specific function: Unknown
COG id: COG2985
COG function: function code R; Predicted permease
Gene ontology:
Cell location: Cell membrane; Multi-pass membrane protein (Potential)
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 2 RCK C-terminal domains
Homologues:
Organism=Escherichia coli, GI87082315, Length=554, Percent_Identity=32.8519855595668, Blast_Score=236, Evalue=3e-63, Organism=Escherichia coli, GI1787071, Length=562, Percent_Identity=24.5551601423488, Blast_Score=128, Evalue=9e-31,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): Y830_CORDI (Q6NIE7)
Other databases:
- EMBL: BX248356 - RefSeq: NP_939194.1 - ProteinModelPortal: Q6NIE7 - GeneID: 2649292 - GenomeReviews: BX248353_GR - KEGG: cdi:DIP0830 - NMPDR: fig|257309.1.peg.785 - HOGENOM: HBG452396 - OMA: RIMSPQL - PhylomeDB: Q6NIE7 - ProtClustDB: CLSK633680 - BioCyc: CDIP257309:DIP0830-MONOMER - InterPro: IPR006037 - InterPro: IPR006512 - TIGRFAMs: TIGR01625
Pfam domain/function: PF06826 Asp-Al_Ex; PF02080 TrkA_C
EC number: NA
Molecular weight: Translated: 56824; Mature: 56824
Theoretical pI: Translated: 7.37; Mature: 7.37
Prosite motif: PS51202 RCK_C
Important sites: NA
Signals:
None
Transmembrane regions:
HASH(0xc4b25b0)-; HASH(0x116746e8)-; HASH(0x11677058)-; HASH(0x114ec3a8)-; HASH(0x114f6314)-; HASH(0x114e6b34)-; HASH(0x11676fe0)-; HASH(0x116761ac)-; HASH(0x114ddaa4)-; HASH(0x1166b5ec)-;
Cys/Met content:
0.2 %Cys (Translated Protein) 1.8 %Met (Translated Protein) 2.0 %Cys+Met (Translated Protein) 0.2 %Cys (Mature Protein) 1.8 %Met (Mature Protein) 2.0 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MDIFVANPLLALFVIMAVGLAIGQVKIRGFSLGVAAVLFAGVGFAAVEPDIHIPHLVYIL CCEEECCHHHHHHHHHHHHHHHCEEEEEEEHHHHHHHHHHCCCCEEECCCCCCHHHHHHH GLSIFVYSIGLESGHAFFALFKSQGVKQNALAITALALITGISIALFSLIHLNGVTAAGL HHHHHHHHHCCCCCCCEEEEEHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHH FTGAVTNTPAMAAVVDSLPSIFGDANKVHEVESLPLVAYSLAYPIGVLGVIAAIGLCAKW HHCCCCCCCHHHHHHHHHHHHHCCCHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHH FRIDHVQEAHDAGVAVEDLFTRQIKVNHVVTGSDLVIDIHHTLGLEIIVSRIERDGQQTL HHHHHHHHHHHCCCCHHHHHHHHEEEEEEEECCCEEEEEHHHHHHHHHHHHHHCCCCCCC PTASSRIHMGDVLSVVGTAEELDKAAHVLGDLLPGDPFHGHDLDYRRIFVSNQDLVGIPL CCCCCCEEHHHHHHHHCCHHHHHHHHHHHHHCCCCCCCCCCCCCEEEEEECCCCEECCCH AKLRPRLSGILITRVRRGDHDHVATPETVLQLGDRVRVVAAHDRMKSVTALFGDSYRRLS HHHCHHHHHEEEEEECCCCCCCCCCHHHHHHCCCCEEEEEHHHHHHHHHHHHCCHHHHHC DFNLFPLVAGLALGLLVGMIEVPLPGGAALSLGSAGGPLVVALVLGAVGRSGRFVWQVPY CCCHHHHHHHHHHHHHHHHHHCCCCCCCEEECCCCCCHHHHHHHHHHCCCCCCEEEECCC GANLALRQLGITLFLAAIGTTAGASFRASLSDPASLTIIAVGAIITLTLAIFVLVVGYKV CCCHHHHHHHHHHHHHHHHCCCCCCEEECCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHH MKIPYGQTAGMLAGIQTHPAVLSYVSAMTKNDLPALGYTSVYPLAMIAKIIAAQVVLFAL EECCCCCCCHHHCCCCCCHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHHHHCC T H >Mature Secondary Structure MDIFVANPLLALFVIMAVGLAIGQVKIRGFSLGVAAVLFAGVGFAAVEPDIHIPHLVYIL CCEEECCHHHHHHHHHHHHHHHCEEEEEEEHHHHHHHHHHCCCCEEECCCCCCHHHHHHH GLSIFVYSIGLESGHAFFALFKSQGVKQNALAITALALITGISIALFSLIHLNGVTAAGL HHHHHHHHHCCCCCCCEEEEEHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHH FTGAVTNTPAMAAVVDSLPSIFGDANKVHEVESLPLVAYSLAYPIGVLGVIAAIGLCAKW HHCCCCCCCHHHHHHHHHHHHHCCCHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHH FRIDHVQEAHDAGVAVEDLFTRQIKVNHVVTGSDLVIDIHHTLGLEIIVSRIERDGQQTL HHHHHHHHHHHCCCCHHHHHHHHEEEEEEEECCCEEEEEHHHHHHHHHHHHHHCCCCCCC PTASSRIHMGDVLSVVGTAEELDKAAHVLGDLLPGDPFHGHDLDYRRIFVSNQDLVGIPL CCCCCCEEHHHHHHHHCCHHHHHHHHHHHHHCCCCCCCCCCCCCEEEEEECCCCEECCCH AKLRPRLSGILITRVRRGDHDHVATPETVLQLGDRVRVVAAHDRMKSVTALFGDSYRRLS HHHCHHHHHEEEEEECCCCCCCCCCHHHHHHCCCCEEEEEHHHHHHHHHHHHCCHHHHHC DFNLFPLVAGLALGLLVGMIEVPLPGGAALSLGSAGGPLVVALVLGAVGRSGRFVWQVPY CCCHHHHHHHHHHHHHHHHHHCCCCCCCEEECCCCCCHHHHHHHHHHCCCCCCEEEECCC GANLALRQLGITLFLAAIGTTAGASFRASLSDPASLTIIAVGAIITLTLAIFVLVVGYKV CCCHHHHHHHHHHHHHHHHCCCCCCEEECCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHH MKIPYGQTAGMLAGIQTHPAVLSYVSAMTKNDLPALGYTSVYPLAMIAKIIAAQVVLFAL EECCCCCCCHHHCCCCCCHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHHHHCC T H
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 6.0
TargetDB status: NA
Availability: NA
References: 14602910