| Definition | Escherichia coli HS, complete genome. |
|---|---|
| Accession | NC_009800 |
| Length | 4,643,538 |
Click here to switch to the map view.
The map label for this gene is ygdL
Identifier: 157162266
GI number: 157162266
Start: 2963245
End: 2964051
Strand: Reverse
Name: ygdL
Synonym: EcHS_A2956
Alternate gene names: 157162266
Gene position: 2964051-2963245 (Counterclockwise)
Preceding gene: 157162267
Following gene: 157162263
Centisome position: 63.83
GC content: 54.89
Gene sequence:
>807_bases ATGTCTGTGGTAATTAGTGATGCATGGCGTCAGCGTTTTGGTGGCACAGCGCGTCTGTATGGTGAAAAAGCGTTGCAACT GTTTGCTGACGCGCATATTTGTGTGGTCGGTATTGGCGGTGTCGGTTCCTGGGCGGCGGAAGCGCTGGCGCGCACGGGGA TTGGCGCAATCACGCTTATCGATATGGATGATGTGTGCGTCACCAATACCAATCGGCAAATTCATGCCCTGCGCGATAAC GTTGGGCTGGCAAAAGCGGAAGTCATGGCGGAACGTATTCGCCAGATTAACCCGGAGTGCCGTGTAACGGTGGTGGATGA TTTCGTGACGCCGGATAACGTAGCGCAGTATATGAGCGTGGGTTATTCGTACGTGATTGATGCCATTGATAGTGTACGGC CCAAAGCGGCGCTGATTGCTTATTGTCGGCGCAATAAAATCCCGCTGGTCACGACCGGTGGCGCGGGTGGGCAGATTGAC CCGACGCAGATTCAGGTTACCGATCTGGCGAAAACGATTCAGGATCCGCTGGCGGCGAAGTTGCGCGAGCGCCTGAAAAG CGATTTTGGCGTAGTGAAAAACAGTAAAGGTAAGCTCGGCGTGGATTGCGTGTTTTCTACTGAAGCGCTGGTGTACCCGC AGTCAGACGGTACGGTGTGTGCGATGAAAGCCACGGCAGAAGGGCCAAAGCGGATGGATTGTGCATCTGGATTTGGCGCG GCAACGATGGTGACCGCCACCTTTGGGTTTGTTGCGGTTTCTCATGCGCTGAAGAAGATGATGGCGAAAGCGGCGCGTCA GGGTTAA
Upstream 100 bases:
>100_bases AAATATTGCAGGAGTTATGTAGGCCTGATAAGCGTAGCGCATCAGGCATTTATGCGTTTAGGGTGAGGGATAACCTCGCC CTTTTTAATTCTGAGGTGCT
Downstream 100 bases:
>100_bases ACAATCAGGTCGGATGAGACGCGAACGTCTTATCCGACCCGGTTCTGTGCTTAAACCTGCTTCGTCGCAGCGATAATCGC CTCGCTTAACGCATTTAACC
Product: ThiF family protein
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 268; Mature: 267
Protein sequence:
>268_residues MSVVISDAWRQRFGGTARLYGEKALQLFADAHICVVGIGGVGSWAAEALARTGIGAITLIDMDDVCVTNTNRQIHALRDN VGLAKAEVMAERIRQINPECRVTVVDDFVTPDNVAQYMSVGYSYVIDAIDSVRPKAALIAYCRRNKIPLVTTGGAGGQID PTQIQVTDLAKTIQDPLAAKLRERLKSDFGVVKNSKGKLGVDCVFSTEALVYPQSDGTVCAMKATAEGPKRMDCASGFGA ATMVTATFGFVAVSHALKKMMAKAARQG
Sequences:
>Translated_268_residues MSVVISDAWRQRFGGTARLYGEKALQLFADAHICVVGIGGVGSWAAEALARTGIGAITLIDMDDVCVTNTNRQIHALRDN VGLAKAEVMAERIRQINPECRVTVVDDFVTPDNVAQYMSVGYSYVIDAIDSVRPKAALIAYCRRNKIPLVTTGGAGGQID PTQIQVTDLAKTIQDPLAAKLRERLKSDFGVVKNSKGKLGVDCVFSTEALVYPQSDGTVCAMKATAEGPKRMDCASGFGA ATMVTATFGFVAVSHALKKMMAKAARQG >Mature_267_residues SVVISDAWRQRFGGTARLYGEKALQLFADAHICVVGIGGVGSWAAEALARTGIGAITLIDMDDVCVTNTNRQIHALRDNV GLAKAEVMAERIRQINPECRVTVVDDFVTPDNVAQYMSVGYSYVIDAIDSVRPKAALIAYCRRNKIPLVTTGGAGGQIDP TQIQVTDLAKTIQDPLAAKLRERLKSDFGVVKNSKGKLGVDCVFSTEALVYPQSDGTVCAMKATAEGPKRMDCASGFGAA TMVTATFGFVAVSHALKKMMAKAARQG
Specific function: Unknown
COG id: COG1179
COG function: function code H; Dinucleotide-utilizing enzymes involved in molybdopterin and thiamine biosynthesis family 1
Gene ontology:
Cell location: Membrane; Single-pass membrane protein (Potential)
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the hesA/moeB/thiF family
Homologues:
Organism=Homo sapiens, GI4885649, Length=143, Percent_Identity=30.7692307692308, Blast_Score=68, Evalue=1e-11, Organism=Escherichia coli, GI1789177, Length=268, Percent_Identity=100, Blast_Score=550, Evalue=1e-158, Organism=Escherichia coli, GI87082356, Length=136, Percent_Identity=30.1470588235294, Blast_Score=71, Evalue=6e-14, Organism=Escherichia coli, GI1787048, Length=131, Percent_Identity=32.824427480916, Blast_Score=71, Evalue=8e-14, Organism=Caenorhabditis elegans, GI17540406, Length=131, Percent_Identity=31.2977099236641, Blast_Score=64, Evalue=9e-11, Organism=Saccharomyces cerevisiae, GI6321790, Length=205, Percent_Identity=24.8780487804878, Blast_Score=92, Evalue=6e-20, Organism=Saccharomyces cerevisiae, GI6322825, Length=202, Percent_Identity=31.1881188118812, Blast_Score=92, Evalue=1e-19, Organism=Drosophila melanogaster, GI24582879, Length=132, Percent_Identity=31.8181818181818, Blast_Score=72, Evalue=4e-13, Organism=Drosophila melanogaster, GI24660640, Length=137, Percent_Identity=29.9270072992701, Blast_Score=71, Evalue=6e-13,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): YGDL_ECOLI (Q46927)
Other databases:
- EMBL: U29581 - EMBL: U00096 - EMBL: AP009048 - PIR: H65063 - RefSeq: AP_003378.1 - RefSeq: NP_417292.1 - ProteinModelPortal: Q46927 - SMR: Q46927 - STRING: Q46927 - EnsemblBacteria: EBESCT00000002841 - EnsemblBacteria: EBESCT00000015495 - GeneID: 947291 - GenomeReviews: AP009048_GR - GenomeReviews: U00096_GR - KEGG: ecj:JW2783 - KEGG: eco:b2812 - EchoBASE: EB2893 - EcoGene: EG13084 - eggNOG: COG1179 - GeneTree: EBGT00050000010430 - HOGENOM: HBG321303 - OMA: DPTQIQI - ProtClustDB: PRK15116 - BioCyc: EcoCyc:G7456-MONOMER - Genevestigator: Q46927 - InterPro: IPR009036 - InterPro: IPR016040 - InterPro: IPR000594 - Gene3D: G3DSA:3.40.50.720
Pfam domain/function: PF00899 ThiF; SSF69572 MoeB
EC number: NA
Molecular weight: Translated: 28562; Mature: 28431
Theoretical pI: Translated: 8.67; Mature: 8.67
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
HASH(0x16c9f338)-;
Cys/Met content:
2.6 %Cys (Translated Protein) 3.4 %Met (Translated Protein) 6.0 %Cys+Met (Translated Protein) 2.6 %Cys (Mature Protein) 3.0 %Met (Mature Protein) 5.6 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MSVVISDAWRQRFGGTARLYGEKALQLFADAHICVVGIGGVGSWAAEALARTGIGAITLI CEEEECHHHHHHHCCCEEHHHHHHHHHHHCCCEEEEEECCCCHHHHHHHHHCCCCEEEEE DMDDVCVTNTNRQIHALRDNVGLAKAEVMAERIRQINPECRVTVVDDFVTPDNVAQYMSV ECCCEEEECCCCEEEEHHHCCCHHHHHHHHHHHHHCCCCEEEEEEECCCCHHHHHHHHHH GYSYVIDAIDSVRPKAALIAYCRRNKIPLVTTGGAGGQIDPTQIQVTDLAKTIQDPLAAK HHHHHHHHHHCCCCHHHHHHHHHCCCCCEEEECCCCCCCCCCEEEHHHHHHHHHHHHHHH LRERLKSDFGVVKNSKGKLGVDCVFSTEALVYPQSDGTVCAMKATAEGPKRMDCASGFGA HHHHHHHHHCCEECCCCCCCEEEEEECCEEEEECCCCCEEEEEECCCCCCCCHHHCCCCH ATMVTATFGFVAVSHALKKMMAKAARQG HHHHHHHHHHHHHHHHHHHHHHHHHCCH >Mature Secondary Structure SVVISDAWRQRFGGTARLYGEKALQLFADAHICVVGIGGVGSWAAEALARTGIGAITLI EEEECHHHHHHHCCCEEHHHHHHHHHHHCCCEEEEEECCCCHHHHHHHHHCCCCEEEEE DMDDVCVTNTNRQIHALRDNVGLAKAEVMAERIRQINPECRVTVVDDFVTPDNVAQYMSV ECCCEEEECCCCEEEEHHHCCCHHHHHHHHHHHHHCCCCEEEEEEECCCCHHHHHHHHHH GYSYVIDAIDSVRPKAALIAYCRRNKIPLVTTGGAGGQIDPTQIQVTDLAKTIQDPLAAK HHHHHHHHHHCCCCHHHHHHHHHCCCCCEEEECCCCCCCCCCEEEHHHHHHHHHHHHHHH LRERLKSDFGVVKNSKGKLGVDCVFSTEALVYPQSDGTVCAMKATAEGPKRMDCASGFGA HHHHHHHHHCCEECCCCCCCEEEEEECCEEEEECCCCCEEEEEECCCCCCCCHHHCCCCH ATMVTATFGFVAVSHALKKMMAKAARQG HHHHHHHHHHHHHHHHHHHHHHHHHCCH
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 7.0
TargetDB status: NA
Availability: NA
References: 9278503