| Definition | Escherichia coli HS, complete genome. |
|---|---|
| Accession | NC_009800 |
| Length | 4,643,538 |
Click here to switch to the map view.
The map label for this gene is yebQ
Identifier: 157161295
GI number: 157161295
Start: 1929253
End: 1930626
Strand: Direct
Name: yebQ
Synonym: EcHS_A1919
Alternate gene names: 157161295
Gene position: 1929253-1930626 (Clockwise)
Preceding gene: 157161293
Following gene: 157161300
Centisome position: 41.55
GC content: 52.33
Gene sequence:
>1374_bases ATGCCAAAAGTTCAGGCCGACGGCCTGCCATTGCCCCAGCGATACGGTGCGATATTAACCATTGTGATTGGTATTTCGAT GGCTGTCCTTGACGGCGCAATCGCCAACGTCGCCCTGCCAACAATCGCCACGGACCTTCATGCCACGCCAGCCAGTTCCA TCTGGGTAGTGAACGCCTATCAAATCGCCATTGTCATCTCCCTGCTCTCGTTTTCGTTTCTGGGCGATATGTTTGGCTAT CGACGTATTTATAAATGCGGTCTGGTCGTTTTTCTGTTGTCTTCACTGTTCTGCGCCCTTTCTGATTCGCTGCAAATGCT CACCCTTGCGCGTGTCATACAAGGTTTCGGCGGTGCAGCGTTGATGAGCGTTAATACCGCACTTATCCGCCTGATCTATC CACAACGTTTTCTGGGGAGAGGGATGGGCATAAACTCGTTTATTGTTGCCGTCTCTTCTGCTGCCGGGCCGACAATTGCT GCAGCAATCCTCTCCATCGCATCCTGGAAATGGTTATTTTTAATCAACGTACCGTTAGGTATTATCGCCCTGCTTCTGGC GATGCGTTTTCTGCCACCCAATGGTTCTCGCGCCAGTAAACCCCGTTTCGACCTGCCCAGCGCCGTGATGAACGCGTTAA CCTTCGGCCTGCTTATCACTGCGTTGAGTGGTTTCGCTCAGGGGCAATCGCTAACGTTAATTGCTGCGGAACTGGTGGTA ATGGTTGTTGTTGGTATTTTCTTTATTCGCCGCCAGCTTTCTCTTCCCGTACCGCTGCTACCGGTGGATTTACTGCGTAT CCCGCTGTTTTCACTTTCTATTTGCACATCTGTTTGCTCTTTCTGCGCACAAATGCTGGCAATGGTTTCCCTGCCCTTTT ACCTGCAAACCGTGCTCGGGCGTAGTGAAGTCGAAACAGGTTTACTTCTGACACCGTGGCCGTTAGCAACGATGGTGATG GCTCCGCTGGCAGGCTATTTGATTGAACGCGTACATGCAGGATTGCTGGGTGCTTTAGGGTTGTTCATCATGGCTGCGGG GCTTTTTTCCCTGGTTCTGCTGCCCGCGTCACCTGCGGATATCAATATTATCTGGCCGATGATCTTATGTGGCGCTGGAT TTGGCTTATTCCAGTCACCCAATAACCACACCATTATTACCTCCGCTCCGCGCGAACGTAGCGGTGGGGCCAGTGGCATG TTAGGAACGGCTCGTCTACTGGGTCAGAGTAGTGGCGCGGCGCTGGTGGCGCTGATGCTAAATCAGTTCGGTGATAATGG TACGCACGTTTCGCTGATGGCTGCGGCTATTCTGGCAGTGATTGCTGCCTGTGTGAGTGGTTTACGTATCACTCAGCCAC GATCCAGGGCATAA
Upstream 100 bases:
>100_bases CCATCTTTTGCCGGTTAGTTACAATTCTGCGACATCCACCGTGAATATCAGTGCTAGAATCATACCCCTGTTGATTATTC ACCAAAGATATAAAATTCCT
Downstream 100 bases:
>100_bases AAAAAGCGCGTCGATCAGGACGCGCTTTTTAGTATTTACTTCATATTACTTCAGGTATTCACCCGTACGCAGAGCTTCAA TTCGTTTATCCAGCGGCGGG
Product: major facilitator transporter
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 457; Mature: 456
Protein sequence:
>457_residues MPKVQADGLPLPQRYGAILTIVIGISMAVLDGAIANVALPTIATDLHATPASSIWVVNAYQIAIVISLLSFSFLGDMFGY RRIYKCGLVVFLLSSLFCALSDSLQMLTLARVIQGFGGAALMSVNTALIRLIYPQRFLGRGMGINSFIVAVSSAAGPTIA AAILSIASWKWLFLINVPLGIIALLLAMRFLPPNGSRASKPRFDLPSAVMNALTFGLLITALSGFAQGQSLTLIAAELVV MVVVGIFFIRRQLSLPVPLLPVDLLRIPLFSLSICTSVCSFCAQMLAMVSLPFYLQTVLGRSEVETGLLLTPWPLATMVM APLAGYLIERVHAGLLGALGLFIMAAGLFSLVLLPASPADINIIWPMILCGAGFGLFQSPNNHTIITSAPRERSGGASGM LGTARLLGQSSGAALVALMLNQFGDNGTHVSLMAAAILAVIAACVSGLRITQPRSRA
Sequences:
>Translated_457_residues MPKVQADGLPLPQRYGAILTIVIGISMAVLDGAIANVALPTIATDLHATPASSIWVVNAYQIAIVISLLSFSFLGDMFGY RRIYKCGLVVFLLSSLFCALSDSLQMLTLARVIQGFGGAALMSVNTALIRLIYPQRFLGRGMGINSFIVAVSSAAGPTIA AAILSIASWKWLFLINVPLGIIALLLAMRFLPPNGSRASKPRFDLPSAVMNALTFGLLITALSGFAQGQSLTLIAAELVV MVVVGIFFIRRQLSLPVPLLPVDLLRIPLFSLSICTSVCSFCAQMLAMVSLPFYLQTVLGRSEVETGLLLTPWPLATMVM APLAGYLIERVHAGLLGALGLFIMAAGLFSLVLLPASPADINIIWPMILCGAGFGLFQSPNNHTIITSAPRERSGGASGM LGTARLLGQSSGAALVALMLNQFGDNGTHVSLMAAAILAVIAACVSGLRITQPRSRA >Mature_456_residues PKVQADGLPLPQRYGAILTIVIGISMAVLDGAIANVALPTIATDLHATPASSIWVVNAYQIAIVISLLSFSFLGDMFGYR RIYKCGLVVFLLSSLFCALSDSLQMLTLARVIQGFGGAALMSVNTALIRLIYPQRFLGRGMGINSFIVAVSSAAGPTIAA AILSIASWKWLFLINVPLGIIALLLAMRFLPPNGSRASKPRFDLPSAVMNALTFGLLITALSGFAQGQSLTLIAAELVVM VVVGIFFIRRQLSLPVPLLPVDLLRIPLFSLSICTSVCSFCAQMLAMVSLPFYLQTVLGRSEVETGLLLTPWPLATMVMA PLAGYLIERVHAGLLGALGLFIMAAGLFSLVLLPASPADINIIWPMILCGAGFGLFQSPNNHTIITSAPRERSGGASGML GTARLLGQSSGAALVALMLNQFGDNGTHVSLMAAAILAVIAACVSGLRITQPRSRA
Specific function: Unknown
COG id: NA
COG function: NA
Gene ontology:
Cell location: Cell inner membrane; Multi-pass membrane protein (Potential)
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the major facilitator superfamily. TCR/tet family
Homologues:
Organism=Escherichia coli, GI87081983, Length=457, Percent_Identity=100, Blast_Score=893, Evalue=0.0, Organism=Escherichia coli, GI1790195, Length=437, Percent_Identity=27.9176201372998, Blast_Score=126, Evalue=3e-30, Organism=Escherichia coli, GI1789042, Length=425, Percent_Identity=27.2941176470588, Blast_Score=117, Evalue=1e-27, Organism=Escherichia coli, GI1788392, Length=429, Percent_Identity=29.1375291375291, Blast_Score=117, Evalue=2e-27, Organism=Escherichia coli, GI1788710, Length=440, Percent_Identity=26.3636363636364, Blast_Score=114, Evalue=1e-26, Organism=Saccharomyces cerevisiae, GI6325455, Length=167, Percent_Identity=28.1437125748503, Blast_Score=68, Evalue=3e-12,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): YEBQ_ECOLI (P76269)
Other databases:
- EMBL: U00096 - EMBL: AP009048 - RefSeq: AP_002448.1 - RefSeq: NP_416342.4 - ProteinModelPortal: P76269 - STRING: P76269 - EnsemblBacteria: EBESCT00000000860 - EnsemblBacteria: EBESCT00000015845 - GeneID: 946048 - GenomeReviews: AP009048_GR - GenomeReviews: U00096_GR - KEGG: ecj:JW5299 - KEGG: eco:b1828 - EchoBASE: EB3773 - EcoGene: EG14019 - eggNOG: COG0477 - GeneTree: EBGT00050000008825 - HOGENOM: HBG679341 - OMA: ICTSICS - ProtClustDB: CLSK880224 - BioCyc: EcoCyc:B1828-MONOMER - Genevestigator: P76269 - InterPro: IPR020846 - InterPro: IPR011701 - InterPro: IPR016196 - InterPro: IPR001411 - PRINTS: PR01036
Pfam domain/function: PF07690 MFS_1; SSF103473 MFS_gen_substrate_transporter
EC number: NA
Molecular weight: Translated: 48152; Mature: 48021
Theoretical pI: Translated: 9.92; Mature: 9.92
Prosite motif: PS50850 MFS
Important sites: NA
Signals:
None
Transmembrane regions:
HASH(0x14f4fa08)-; HASH(0x1480d3d0)-; HASH(0x14de39a8)-; HASH(0x15204398)-; HASH(0x11abd7f0)-; HASH(0x14ccda90)-; HASH(0x11a71574)-; HASH(0x1413ffa0)-; HASH(0x14e1fa78)-; HASH(0x14ce0e40)-; HASH(0x148b31a4)-; HASH(0x14d1f988)-; HASH(0x155599c0)-; HASH(0x15163c68)-;
Cys/Met content:
1.5 %Cys (Translated Protein) 3.9 %Met (Translated Protein) 5.5 %Cys+Met (Translated Protein) 1.5 %Cys (Mature Protein) 3.7 %Met (Mature Protein) 5.3 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MPKVQADGLPLPQRYGAILTIVIGISMAVLDGAIANVALPTIATDLHATPASSIWVVNAY CCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCEEEEHHH QIAIVISLLSFSFLGDMFGYRRIYKCGLVVFLLSSLFCALSDSLQMLTLARVIQGFGGAA HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHH LMSVNTALIRLIYPQRFLGRGMGINSFIVAVSSAAGPTIAAAILSIASWKWLFLINVPLG HHHHHHHHHHHHHHHHHHHCCCCCHHHHHEECCCCCHHHHHHHHHHHCCCEEEEEECCHH IIALLLAMRFLPPNGSRASKPRFDLPSAVMNALTFGLLITALSGFAQGQSLTLIAAELVV HHHHHHHHHHCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHH MVVVGIFFIRRQLSLPVPLLPVDLLRIPLFSLSICTSVCSFCAQMLAMVSLPFYLQTVLG HHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHC RSEVETGLLLTPWPLATMVMAPLAGYLIERVHAGLLGALGLFIMAAGLFSLVLLPASPAD HHHHCCCEEECCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCC INIIWPMILCGAGFGLFQSPNNHTIITSAPRERSGGASGMLGTARLLGQSSGAALVALML CCHHHHHHHHCCCCCCCCCCCCCEEEECCCCCCCCCCCCCHHHHHHHCCCCCHHHHHHHH NQFGDNGTHVSLMAAAILAVIAACVSGLRITQPRSRA HHHCCCCCHHHHHHHHHHHHHHHHHCCCEECCCCCCH >Mature Secondary Structure PKVQADGLPLPQRYGAILTIVIGISMAVLDGAIANVALPTIATDLHATPASSIWVVNAY CCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCEEEEHHH QIAIVISLLSFSFLGDMFGYRRIYKCGLVVFLLSSLFCALSDSLQMLTLARVIQGFGGAA HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHH LMSVNTALIRLIYPQRFLGRGMGINSFIVAVSSAAGPTIAAAILSIASWKWLFLINVPLG HHHHHHHHHHHHHHHHHHHCCCCCHHHHHEECCCCCHHHHHHHHHHHCCCEEEEEECCHH IIALLLAMRFLPPNGSRASKPRFDLPSAVMNALTFGLLITALSGFAQGQSLTLIAAELVV HHHHHHHHHHCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHH MVVVGIFFIRRQLSLPVPLLPVDLLRIPLFSLSICTSVCSFCAQMLAMVSLPFYLQTVLG HHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHC RSEVETGLLLTPWPLATMVMAPLAGYLIERVHAGLLGALGLFIMAAGLFSLVLLPASPAD HHHHCCCEEECCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCC INIIWPMILCGAGFGLFQSPNNHTIITSAPRERSGGASGMLGTARLLGQSSGAALVALML CCHHHHHHHHCCCCCCCCCCCCCEEEECCCCCCCCCCCCCHHHHHHHCCCCCHHHHHHHH NQFGDNGTHVSLMAAAILAVIAACVSGLRITQPRSRA HHHCCCCCHHHHHHHHHHHHHHHHHCCCEECCCCCCH
PDB accession: NA
Resolution: NA
Structure class: Alpha
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 6.0
TargetDB status: NA
Availability: NA
References: 9097040; 9278503