| Definition | Escherichia coli 55989, complete genome. |
|---|---|
| Accession | NC_011748 |
| Length | 5,154,862 |
Click here to switch to the map view.
The map label for this gene is ydcO
Identifier: 218694975
GI number: 218694975
Start: 1613435
End: 1614610
Strand: Reverse
Name: ydcO
Synonym: EC55989_1566
Alternate gene names: 218694975
Gene position: 1614610-1613435 (Counterclockwise)
Preceding gene: 218694978
Following gene: 218694973
Centisome position: 31.32
GC content: 52.89
Gene sequence:
>1176_bases ATGCGTCTGTTTTCTATTCCTCCACCCACGCTACTGGCGGGGTTTCTGGCGGTATTAATTGGCTACGCCAGTTCAGCGGC AATAATCTGGCAAGCAGCGATTGTCGCCGGAGCCACCACTGCACAAATCTCTGGCTGGATGACGGCGCTGGGGCTGGCAA TGGGCGTCAGTACGCTGACTCTGACATTATGGTATCGCGTACCTGTTCTCACCGCATGGTCAACGCCTGGCGCGGCTTTG TTGGTCACCGGATTGCAGGGACTAACACTTAACGAAGCCATCGGCGTTTTTATTGTCACCAACGCGTTAATAGTCCTCTG CGGCATAACGGGACTCTTTGCTCGTCTGATGCGCATTATTCCGCACTCGCTTGCGGCGGCAATGCTTGCCGGGATTTTAT TACGCTTTGGTTTACAGGCGTTTGCCAGTCTGGACGGTCAATTTACGTTGTGTGGAAGTATGTTGCTGGTATGGCTGGCA ACCAAGGCCGTTGCGCCGCGCTATGCGGTAATTGCCGCGATGATTATTGGGATCGTGATCGTTATCGCGCAAGGTGACGT TGTCACAACTGATGTTGTCTTTAAACCCGTTCTCCCCACTTATATTACCCCTGATTTTTCGTTTGCTCACAGCCTGAGCG TTGCACTCCCCCTTTTTCTGGTGACGATGGCATCGCAAAACGCACCGGGTATCGCAGCAATGAAAGCAGCTGGATATTCG GCTCCTGTTTCGCCATTAATTGTATTTACTGGATTGCTGGCACTGGTTTTTTCCCCTTTCGGCGTTTATTCCGTCGGTAT TGCGGCAATCACCGCGGCTATTTGCCAAAGCCCGGAAGCGCATCCGGATAAAGATCAACGTTGGCTGGCAGCTGCCGTTG CAGGCATTTTCTATTTGCTCGCAGGTCTGTTTGGTAGTGCCATTACCGGGATGATGGCTGCCCTGCCCGTAAGTTGGATC CAGATGCTGGCAGGTCTGGCGCTGTTGAGTACCATTGGCGGCAGTTTGTATCAGGCGCTGCATAATGAGCGTGAGCGCGA CGCGGCGGTGGTGGCATTTCTGGTAACGGCAAGTGGATTGACGCTGGTCGGGATTGGTTCTGCGTTCTGGGGATTAATTG CCGGAGGCGTTTGTTACGTGGTGTTGAATTTAATCGCTGACAGAAACCGATATTGA
Upstream 100 bases:
>100_bases ATTTTCCATGCGACTCCTCCGGCAAAACGGAAGTTTATCACTTGTGCGTTATAACGGACAAATGCTACGGTGCCTGTACG CTATAACGCACGAGGTGACT
Downstream 100 bases:
>100_bases CATCCTCCACGCCCTGAAGGACGAGGATCCCTGCTACGTTCAGGCTGTCGCCTGAATCATTTCGGTGGGTTCCTGCTTCA ACGGGCGGCCTGACTGCACC
Product: putative benzoate transporter
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 391; Mature: 391
Protein sequence:
>391_residues MRLFSIPPPTLLAGFLAVLIGYASSAAIIWQAAIVAGATTAQISGWMTALGLAMGVSTLTLTLWYRVPVLTAWSTPGAAL LVTGLQGLTLNEAIGVFIVTNALIVLCGITGLFARLMRIIPHSLAAAMLAGILLRFGLQAFASLDGQFTLCGSMLLVWLA TKAVAPRYAVIAAMIIGIVIVIAQGDVVTTDVVFKPVLPTYITPDFSFAHSLSVALPLFLVTMASQNAPGIAAMKAAGYS APVSPLIVFTGLLALVFSPFGVYSVGIAAITAAICQSPEAHPDKDQRWLAAAVAGIFYLLAGLFGSAITGMMAALPVSWI QMLAGLALLSTIGGSLYQALHNERERDAAVVAFLVTASGLTLVGIGSAFWGLIAGGVCYVVLNLIADRNRY
Sequences:
>Translated_391_residues MRLFSIPPPTLLAGFLAVLIGYASSAAIIWQAAIVAGATTAQISGWMTALGLAMGVSTLTLTLWYRVPVLTAWSTPGAAL LVTGLQGLTLNEAIGVFIVTNALIVLCGITGLFARLMRIIPHSLAAAMLAGILLRFGLQAFASLDGQFTLCGSMLLVWLA TKAVAPRYAVIAAMIIGIVIVIAQGDVVTTDVVFKPVLPTYITPDFSFAHSLSVALPLFLVTMASQNAPGIAAMKAAGYS APVSPLIVFTGLLALVFSPFGVYSVGIAAITAAICQSPEAHPDKDQRWLAAAVAGIFYLLAGLFGSAITGMMAALPVSWI QMLAGLALLSTIGGSLYQALHNERERDAAVVAFLVTASGLTLVGIGSAFWGLIAGGVCYVVLNLIADRNRY >Mature_391_residues MRLFSIPPPTLLAGFLAVLIGYASSAAIIWQAAIVAGATTAQISGWMTALGLAMGVSTLTLTLWYRVPVLTAWSTPGAAL LVTGLQGLTLNEAIGVFIVTNALIVLCGITGLFARLMRIIPHSLAAAMLAGILLRFGLQAFASLDGQFTLCGSMLLVWLA TKAVAPRYAVIAAMIIGIVIVIAQGDVVTTDVVFKPVLPTYITPDFSFAHSLSVALPLFLVTMASQNAPGIAAMKAAGYS APVSPLIVFTGLLALVFSPFGVYSVGIAAITAAICQSPEAHPDKDQRWLAAAVAGIFYLLAGLFGSAITGMMAALPVSWI QMLAGLALLSTIGGSLYQALHNERERDAAVVAFLVTASGLTLVGIGSAFWGLIAGGVCYVVLNLIADRNRY
Specific function: Unknown
COG id: COG3135
COG function: function code Q; Uncharacterized protein involved in benzoate metabolism
Gene ontology:
Cell location: Cell inner membrane; Multi-pass membrane protein
Metaboloic importance: Non Essential [C]
Operon status: Not Known
Operon components: None
Similarity: NA
Homologues:
Organism=Escherichia coli, GI87081909, Length=391, Percent_Identity=100, Blast_Score=759, Evalue=0.0,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): YDCO_ECOLI (P76103)
Other databases:
- EMBL: U00096 - EMBL: AP009048 - PIR: D64895 - RefSeq: AP_002056.1 - RefSeq: NP_415950.4 - ProteinModelPortal: P76103 - STRING: P76103 - EnsemblBacteria: EBESCT00000000333 - EnsemblBacteria: EBESCT00000017914 - GeneID: 947247 - GenomeReviews: AP009048_GR - GenomeReviews: U00096_GR - KEGG: ecj:JW5229 - KEGG: eco:b1433 - EchoBASE: EB3521 - EcoGene: EG13758 - eggNOG: COG3135 - GeneTree: EBGT00050000010306 - HOGENOM: HBG649277 - OMA: ASQNMPG - ProtClustDB: CLSK880073 - BioCyc: EcoCyc:B1433-MONOMER - Genevestigator: P76103 - InterPro: IPR004711 - TIGRFAMs: TIGR00843
Pfam domain/function: PF03594 BenE
EC number: NA
Molecular weight: Translated: 40584; Mature: 40584
Theoretical pI: Translated: 8.59; Mature: 8.59
Prosite motif: PS00041 HTH_ARAC_FAMILY_1
Important sites: NA
Signals:
None
Transmembrane regions:
HASH(0x197fa380)-; HASH(0x1959c954)-; HASH(0x18db4b84)-; HASH(0x194182e8)-; HASH(0x19711d7c)-; HASH(0x19505a7c)-; HASH(0x18f42120)-; HASH(0x162a7ff4)-; HASH(0x18bff75c)-; HASH(0x194ed7a4)-;
Cys/Met content:
1.0 %Cys (Translated Protein) 3.1 %Met (Translated Protein) 4.1 %Cys+Met (Translated Protein) 1.0 %Cys (Mature Protein) 3.1 %Met (Mature Protein) 4.1 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MRLFSIPPPTLLAGFLAVLIGYASSAAIIWQAAIVAGATTAQISGWMTALGLAMGVSTLT CCCCCCCCHHHHHHHHHHHHHHCCCHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHH LTLWYRVPVLTAWSTPGAALLVTGLQGLTLNEAIGVFIVTNALIVLCGITGLFARLMRII HHHHHHHHHEEECCCCCHHEEECCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH PHSLAAAMLAGILLRFGLQAFASLDGQFTLCGSMLLVWLATKAVAPRYAVIAAMIIGIVI HHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHH VIAQGDVVTTDVVFKPVLPTYITPDFSFAHSLSVALPLFLVTMASQNAPGIAAMKAAGYS HHCCCCEEEHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHCCCC APVSPLIVFTGLLALVFSPFGVYSVGIAAITAAICQSPEAHPDKDQRWLAAAVAGIFYLL CCHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHH AGLFGSAITGMMAALPVSWIQMLAGLALLSTIGGSLYQALHNERERDAAVVAFLVTASGL HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCC TLVGIGSAFWGLIAGGVCYVVLNLIADRNRY CEEEHHHHHHHHHHHHHHHHHHHHHHCCCCH >Mature Secondary Structure MRLFSIPPPTLLAGFLAVLIGYASSAAIIWQAAIVAGATTAQISGWMTALGLAMGVSTLT CCCCCCCCHHHHHHHHHHHHHHCCCHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHH LTLWYRVPVLTAWSTPGAALLVTGLQGLTLNEAIGVFIVTNALIVLCGITGLFARLMRII HHHHHHHHHEEECCCCCHHEEECCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH PHSLAAAMLAGILLRFGLQAFASLDGQFTLCGSMLLVWLATKAVAPRYAVIAAMIIGIVI HHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHH VIAQGDVVTTDVVFKPVLPTYITPDFSFAHSLSVALPLFLVTMASQNAPGIAAMKAAGYS HHCCCCEEEHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHCCCC APVSPLIVFTGLLALVFSPFGVYSVGIAAITAAICQSPEAHPDKDQRWLAAAVAGIFYLL CCHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHH AGLFGSAITGMMAALPVSWIQMLAGLALLSTIGGSLYQALHNERERDAAVVAFLVTASGL HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCC TLVGIGSAFWGLIAGGVCYVVLNLIADRNRY CEEEHHHHHHHHHHHHHHHHHHHHHHCCCCH
PDB accession: NA
Resolution: NA
Structure class: Alpha
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: DNA [C]
Specific reaction: Protein + DNA = Protein-DNA [C]
General reaction: NA
Inhibitor: NA
Structure determination priority: 6.0
TargetDB status: NA
Availability: NA
References: 9097039; 9278503