The gene/protein map for NC_000907 is currently unavailable.
Definition Haemophilus influenzae Rd KW20 chromosome, complete genome.
Accession NC_000907
Length 1,830,138

Click here to switch to the map view.

The map label for this gene is ygdL [C]

Identifier: 16272088

GI number: 16272088

Start: 132944

End: 133729

Strand: Direct

Name: ygdL [C]

Synonym: HI0118

Alternate gene names: 16272088

Gene position: 132944-133729 (Clockwise)

Preceding gene: 16273671

Following gene: 16272089

Centisome position: 7.26

GC content: 40.97

Gene sequence:

>786_bases
ATGGGTATTACGGTAATGGCTAGAATAGATAATTACGAACAACGCTTTGGTGGCATTGGACGACTTTATACGCCTGATAG
CTTAGCACGCTTACGCCAAGCGCATATTTGCGTAATAGGCATTGGTGGCGTGGGTTCTTGGGTCGTGGAGGCCTTAGCAC
GATCTGGCATTGGCGAACTCACATTAATTGATATGGATGATATTTGCGTCACAAATATCAATCGCCAACTTCCTGCGATG
AGCGGCACAATCGGCAAATTAAAAACTGAAGTCATGTCAGAGCGAGTAAAATTAATTAACCCAGAATGTACCGTCAATAT
TATTGATGATTTTATCTCGCCAGAGAATCAATCGGATTATCTCAACCGAGGCTATGACTACGTCATTGATGCCATTGACA
ATGTGAAAACTAAAGCGTCGCTGATTGCTTATTGTAAACGTAACAAAATTAATGTGATTACTATTGGCGGTGCTGGCGGT
CAAACTGATCCAACCCAAATTCAAATTGCCGATCTCAGTAAAACCATTCAAGATCCGCTGCTCGCCAAAGTGCGGTCAGT
TTTACGCAAGGATTACAATTTTAGCCAAAATCCAAAGCGTAAATTTAGTATCGATGCGGTATTTTCAACACAACCTTTAA
TATTCCCACAAATGACTGAAGGCTGTTCTACTTCTGCCACAATGAATTGCGCAAATGGGTTTGGCGCAGCCACAATGATT
ACGGCAACCTTTGGTTTTTTTGCCGTTTCTCGTGTAATAGATAAATTACTAAAGAAAAAATCTTAA

Upstream 100 bases:

>100_bases
ATGTAGGCGGTGCAGTGAAAGGTCATCACTTTGACTTATATCGTGGTATCGGTGCTAGAGCAGGACATATTGCAGGGCTT
TCAAAACACTACGGTAGAGT

Downstream 100 bases:

>100_bases
TCACCTCTTGAAAATGCACATTGACCATAAATGTGCATTTTTTATTGAATGAAACCTATTGACTTTGAAAATGAAAAATT
TTCCCTCTTTTTACTATAAA

Product: hypothetical protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 261; Mature: 260

Protein sequence:

>261_residues
MGITVMARIDNYEQRFGGIGRLYTPDSLARLRQAHICVIGIGGVGSWVVEALARSGIGELTLIDMDDICVTNINRQLPAM
SGTIGKLKTEVMSERVKLINPECTVNIIDDFISPENQSDYLNRGYDYVIDAIDNVKTKASLIAYCKRNKINVITIGGAGG
QTDPTQIQIADLSKTIQDPLLAKVRSVLRKDYNFSQNPKRKFSIDAVFSTQPLIFPQMTEGCSTSATMNCANGFGAATMI
TATFGFFAVSRVIDKLLKKKS

Sequences:

>Translated_261_residues
MGITVMARIDNYEQRFGGIGRLYTPDSLARLRQAHICVIGIGGVGSWVVEALARSGIGELTLIDMDDICVTNINRQLPAM
SGTIGKLKTEVMSERVKLINPECTVNIIDDFISPENQSDYLNRGYDYVIDAIDNVKTKASLIAYCKRNKINVITIGGAGG
QTDPTQIQIADLSKTIQDPLLAKVRSVLRKDYNFSQNPKRKFSIDAVFSTQPLIFPQMTEGCSTSATMNCANGFGAATMI
TATFGFFAVSRVIDKLLKKKS
>Mature_260_residues
GITVMARIDNYEQRFGGIGRLYTPDSLARLRQAHICVIGIGGVGSWVVEALARSGIGELTLIDMDDICVTNINRQLPAMS
GTIGKLKTEVMSERVKLINPECTVNIIDDFISPENQSDYLNRGYDYVIDAIDNVKTKASLIAYCKRNKINVITIGGAGGQ
TDPTQIQIADLSKTIQDPLLAKVRSVLRKDYNFSQNPKRKFSIDAVFSTQPLIFPQMTEGCSTSATMNCANGFGAATMIT
ATFGFFAVSRVIDKLLKKKS

Specific function: Unknown

COG id: COG1179

COG function: function code H; Dinucleotide-utilizing enzymes involved in molybdopterin and thiamine biosynthesis family 1

Gene ontology:

Cell location: Membrane; Single-pass membrane protein (Potential)

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the hesA/moeB/thiF family

Homologues:

Organism=Escherichia coli, GI1789177, Length=260, Percent_Identity=57.3076923076923, Blast_Score=323, Evalue=8e-90,
Organism=Escherichia coli, GI87082356, Length=138, Percent_Identity=30.4347826086957, Blast_Score=70, Evalue=2e-13,
Organism=Escherichia coli, GI1787048, Length=136, Percent_Identity=27.2058823529412, Blast_Score=69, Evalue=2e-13,
Organism=Saccharomyces cerevisiae, GI6321790, Length=168, Percent_Identity=31.547619047619, Blast_Score=101, Evalue=1e-22,
Organism=Saccharomyces cerevisiae, GI6322825, Length=143, Percent_Identity=31.4685314685315, Blast_Score=86, Evalue=4e-18,
Organism=Drosophila melanogaster, GI24582879, Length=118, Percent_Identity=33.0508474576271, Blast_Score=70, Evalue=1e-12,
Organism=Drosophila melanogaster, GI24660640, Length=143, Percent_Identity=25.8741258741259, Blast_Score=66, Evalue=3e-11,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): Y118_HAEIN (Q57097)

Other databases:

- EMBL:   L42023
- PIR:   C64049
- RefSeq:   NP_438290.1
- ProteinModelPortal:   Q57097
- SMR:   Q57097
- GeneID:   951021
- GenomeReviews:   L42023_GR
- KEGG:   hin:HI0118
- NMPDR:   fig|71421.1.peg.112
- TIGR:   HI_0118
- HOGENOM:   HBG321303
- OMA:   DPTQIQI
- ProtClustDB:   CLSK870301
- BioCyc:   HINF71421:HI_0118-MONOMER
- GO:   GO:0005488
- InterPro:   IPR009036
- InterPro:   IPR016040
- InterPro:   IPR000594
- Gene3D:   G3DSA:3.40.50.720

Pfam domain/function: PF00899 ThiF; SSF69572 MoeB

EC number: NA

Molecular weight: Translated: 28572; Mature: 28441

Theoretical pI: Translated: 8.78; Mature: 8.78

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

HASH(0xbefe7c4)-;

Cys/Met content:

2.3 %Cys     (Translated Protein)
3.1 %Met     (Translated Protein)
5.4 %Cys+Met (Translated Protein)
2.3 %Cys     (Mature Protein)
2.7 %Met     (Mature Protein)
5.0 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MGITVMARIDNYEQRFGGIGRLYTPDSLARLRQAHICVIGIGGVGSWVVEALARSGIGEL
CCEEEEEECCCHHHHHCCCCCCCCCHHHHHHHHCCEEEEEECCHHHHHHHHHHHCCCCCE
TLIDMDDICVTNINRQLPAMSGTIGKLKTEVMSERVKLINPECTVNIIDDFISPENQSDY
EEEECCCHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHHCCCCEEEEEHHHHCCCCCCCHH
LNRGYDYVIDAIDNVKTKASLIAYCKRNKINVITIGGAGGQTDPTQIQIADLSKTIQDPL
HHCCHHHHHHHHHHHHHHHHHHHHHHCCCEEEEEEECCCCCCCCCEEEEHHHHHHHHHHH
LAKVRSVLRKDYNFSQNPKRKFSIDAVFSTQPLIFPQMTEGCSTSATMNCANGFGAATMI
HHHHHHHHHHCCCCCCCCCCEEEEEEEECCCCCCCCCHHCCCCCCCEEECCCCCCHHHHH
TATFGFFAVSRVIDKLLKKKS
HHHHHHHHHHHHHHHHHHCCH
>Mature Secondary Structure 
GITVMARIDNYEQRFGGIGRLYTPDSLARLRQAHICVIGIGGVGSWVVEALARSGIGEL
CEEEEEECCCHHHHHCCCCCCCCCHHHHHHHHCCEEEEEECCHHHHHHHHHHHCCCCCE
TLIDMDDICVTNINRQLPAMSGTIGKLKTEVMSERVKLINPECTVNIIDDFISPENQSDY
EEEECCCHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHHCCCCEEEEEHHHHCCCCCCCHH
LNRGYDYVIDAIDNVKTKASLIAYCKRNKINVITIGGAGGQTDPTQIQIADLSKTIQDPL
HHCCHHHHHHHHHHHHHHHHHHHHHHCCCEEEEEEECCCCCCCCCEEEEHHHHHHHHHHH
LAKVRSVLRKDYNFSQNPKRKFSIDAVFSTQPLIFPQMTEGCSTSATMNCANGFGAATMI
HHHHHHHHHHCCCCCCCCCCEEEEEEEECCCCCCCCCHHCCCCCCCEEECCCCCCHHHHH
TATFGFFAVSRVIDKLLKKKS
HHHHHHHHHHHHHHHHHHCCH

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 7.0

TargetDB status: NA

Availability: NA

References: 7542800