Definition Escherichia coli HS, complete genome.
Accession NC_009800
Length 4,643,538

Click here to switch to the map view.

The map label for this gene is yfeH

Identifier: 157161874

GI number: 157161874

Start: 2554510

End: 2555508

Strand: Direct

Name: yfeH

Synonym: EcHS_A2544

Alternate gene names: 157161874

Gene position: 2554510-2555508 (Clockwise)

Preceding gene: 157161872

Following gene: 157161878

Centisome position: 55.01

GC content: 51.75

Gene sequence:

>999_bases
ATGAAACTTTTTCGTATCCTCGATCCTTTCACCTTAACCCTGATCACGGTGGTGTTGCTGGCCTCTTTCTTTCCGGCCAG
AGGCGATTTCGTCCCCTTCTTTGAAAATCTGACCACCGCAGCTATTGCCCTGCTGTTCTTTATGCACGGCGCGAAGTTGT
CGCGTGAGGCGATTATTGCTGGCGGTGGTCACTGGCGACTGCATTTGTGGGTAATGTGCAGCACCTTCGTGCTGTTTCCG
ATTCTGGGTGTACTGTTTGCCTGGTGGAAACCGGTAAATGTCGACCCGATGCTCTACTCCGGTTTTCTCTACTTGTGCAT
TCTCCCGGCTACCGTGCAGTCTGCAATCGCCTTCACGTCAATGGCGGGCGGTAACGTCGCGGCAGCGGTTTGTTCTGCGT
CGGCATCCAGCCTGCTGGGGATTTTCCTTTCACCATTGCTGGTTGGTCTGGTGATGAATGTTCACGGTGCAGGGGGCAGC
CTTGAGCAGGTCGGTAAAATTATGCTGCAACTGCTGCTGCCGTTTGTGTTGGGGCATCTTTCCCGGCCGTGGATTGGTGA
CTGGGTGTCGCGCAATAAAAAATGGATTGCGAAAACTGACCAGACGTCCATTCTGTTGGTGGTTTATACAGCGTTCAGCG
AAGCCGTCGTTAATGGTATCTGGCATAAAGTTGGCTGGGGATCATTGCTGTTTATCGTGGTGGTCAGCTGCGTTCTTCTG
GCTATCGTGATTGTAGTTAACGTCTTTATGGCACGCCGACTGAGCTTCAATAAGGCAGATGAAATTACTATCGTCTTTTG
TGGTTCGAAAAAGAGTCTGGCAAATGGCATCCCGATGGCAAACATTCTGTTCCCCACATCGGTGATCGGTATGATGGTGC
TGCCCCTGATGATTTTCCATCAGATCCAATTGATGGTCTGTGCGGTGCTGGCGCGTCGATACAAACGCCAGACCGAACAG
TTACAGGCGCAGCAGGAAAGCAGCGCCGATAAAGCTTAA

Upstream 100 bases:

>100_bases
GAATAATTCATCTGTTTTCTTCATGAATGGATGCAATAAATCAATTTTATTTCTCAAACTGGAAGAAGCACAATAGAACC
ATCGATCATCTGGAGTCTTT

Downstream 100 bases:

>100_bases
AGCGGACGCTTCAGGGGCTGGACCAGTTGCGTCAGCCCCTCGGTTTTAATCAGCAGCGTGATTTGCATTAGCTCACCGAG
CTTCCCTGCCGGGAACTCAT

Product: bile acid/Na+ symporter family protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 332; Mature: 332

Protein sequence:

>332_residues
MKLFRILDPFTLTLITVVLLASFFPARGDFVPFFENLTTAAIALLFFMHGAKLSREAIIAGGGHWRLHLWVMCSTFVLFP
ILGVLFAWWKPVNVDPMLYSGFLYLCILPATVQSAIAFTSMAGGNVAAAVCSASASSLLGIFLSPLLVGLVMNVHGAGGS
LEQVGKIMLQLLLPFVLGHLSRPWIGDWVSRNKKWIAKTDQTSILLVVYTAFSEAVVNGIWHKVGWGSLLFIVVVSCVLL
AIVIVVNVFMARRLSFNKADEITIVFCGSKKSLANGIPMANILFPTSVIGMMVLPLMIFHQIQLMVCAVLARRYKRQTEQ
LQAQQESSADKA

Sequences:

>Translated_332_residues
MKLFRILDPFTLTLITVVLLASFFPARGDFVPFFENLTTAAIALLFFMHGAKLSREAIIAGGGHWRLHLWVMCSTFVLFP
ILGVLFAWWKPVNVDPMLYSGFLYLCILPATVQSAIAFTSMAGGNVAAAVCSASASSLLGIFLSPLLVGLVMNVHGAGGS
LEQVGKIMLQLLLPFVLGHLSRPWIGDWVSRNKKWIAKTDQTSILLVVYTAFSEAVVNGIWHKVGWGSLLFIVVVSCVLL
AIVIVVNVFMARRLSFNKADEITIVFCGSKKSLANGIPMANILFPTSVIGMMVLPLMIFHQIQLMVCAVLARRYKRQTEQ
LQAQQESSADKA
>Mature_332_residues
MKLFRILDPFTLTLITVVLLASFFPARGDFVPFFENLTTAAIALLFFMHGAKLSREAIIAGGGHWRLHLWVMCSTFVLFP
ILGVLFAWWKPVNVDPMLYSGFLYLCILPATVQSAIAFTSMAGGNVAAAVCSASASSLLGIFLSPLLVGLVMNVHGAGGS
LEQVGKIMLQLLLPFVLGHLSRPWIGDWVSRNKKWIAKTDQTSILLVVYTAFSEAVVNGIWHKVGWGSLLFIVVVSCVLL
AIVIVVNVFMARRLSFNKADEITIVFCGSKKSLANGIPMANILFPTSVIGMMVLPLMIFHQIQLMVCAVLARRYKRQTEQ
LQAQQESSADKA

Specific function: Unknown

COG id: COG0385

COG function: function code R; Predicted Na+-dependent transporter

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

Organism=Homo sapiens, GI71725371, Length=280, Percent_Identity=27.5, Blast_Score=118, Evalue=6e-27,
Organism=Escherichia coli, GI1788749, Length=332, Percent_Identity=100, Blast_Score=669, Evalue=0.0,
Organism=Saccharomyces cerevisiae, GI6323677, Length=372, Percent_Identity=20.4301075268817, Blast_Score=70, Evalue=6e-13,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): YFEH_ECOLI (P39836)

Other databases:

- EMBL:   U00096
- EMBL:   AP009048
- EMBL:   M24278
- PIR:   A65015
- RefSeq:   AP_003003.1
- RefSeq:   NP_416905.1
- ProteinModelPortal:   P39836
- STRING:   P39836
- EnsemblBacteria:   EBESCT00000004374
- EnsemblBacteria:   EBESCT00000016115
- GeneID:   946874
- GenomeReviews:   AP009048_GR
- GenomeReviews:   U00096_GR
- KEGG:   ecj:JW5876
- KEGG:   eco:b2410
- EchoBASE:   EB2279
- EcoGene:   EG12376
- eggNOG:   COG0385
- GeneTree:   EBGT00050000010046
- HOGENOM:   HBG291857
- OMA:   GKTDQTS
- ProtClustDB:   CLSK864555
- BioCyc:   EcoCyc:EG12376-MONOMER
- Genevestigator:   P39836
- InterPro:   IPR016833
- PIRSF:   PIRSF026166

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 36406; Mature: 36406

Theoretical pI: Translated: 9.94; Mature: 9.94

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.8 %Cys     (Translated Protein)
3.9 %Met     (Translated Protein)
5.7 %Cys+Met (Translated Protein)
1.8 %Cys     (Mature Protein)
3.9 %Met     (Mature Protein)
5.7 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKLFRILDPFTLTLITVVLLASFFPARGDFVPFFENLTTAAIALLFFMHGAKLSREAIIA
CCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHCCCCCCCEEEE
GGGHWRLHLWVMCSTFVLFPILGVLFAWWKPVNVDPMLYSGFLYLCILPATVQSAIAFTS
CCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHH
MAGGNVAAAVCSASASSLLGIFLSPLLVGLVMNVHGAGGSLEQVGKIMLQLLLPFVLGHL
CCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHC
SRPWIGDWVSRNKKWIAKTDQTSILLVVYTAFSEAVVNGIWHKVGWGSLLFIVVVSCVLL
CCCCCHHHHHCCCCEEEECCCCEEEEHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHH
AIVIVVNVFMARRLSFNKADEITIVFCGSKKSLANGIPMANILFPTSVIGMMVLPLMIFH
HHHHHHHHHHHHHHCCCCCCCEEEEEECCCHHHHCCCCHHHHHHHHHHHHHHHHHHHHHH
QIQLMVCAVLARRYKRQTEQLQAQQESSADKA
HHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCC
>Mature Secondary Structure
MKLFRILDPFTLTLITVVLLASFFPARGDFVPFFENLTTAAIALLFFMHGAKLSREAIIA
CCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHCCCCCCCEEEE
GGGHWRLHLWVMCSTFVLFPILGVLFAWWKPVNVDPMLYSGFLYLCILPATVQSAIAFTS
CCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHH
MAGGNVAAAVCSASASSLLGIFLSPLLVGLVMNVHGAGGSLEQVGKIMLQLLLPFVLGHL
CCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHC
SRPWIGDWVSRNKKWIAKTDQTSILLVVYTAFSEAVVNGIWHKVGWGSLLFIVVVSCVLL
CCCCCHHHHHCCCCEEEECCCCEEEEHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHH
AIVIVVNVFMARRLSFNKADEITIVFCGSKKSLANGIPMANILFPTSVIGMMVLPLMIFH
HHHHHHHHHHHHHHCCCCCCCEEEEEECCCHHHHCCCCHHHHHHHHHHHHHHHHHHHHHH
QIQLMVCAVLARRYKRQTEQLQAQQESSADKA
HHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: 9205837; 9278503; 7984428