Definition Haemophilus influenzae PittGG chromosome, complete genome.
Accession NC_009567
Length 1,887,192

Click here to switch to the map view.

The map label for this gene is thiE [H]

Identifier: 148827620

GI number: 148827620

Start: 966927

End: 967529

Strand: Reverse

Name: thiE [H]

Synonym: CGSHiGG_05315

Alternate gene names: 148827620

Gene position: 967529-966927 (Counterclockwise)

Preceding gene: 148827621

Following gene: 148827617

Centisome position: 51.27

GC content: 34.83

Gene sequence:

>603_bases
ATGAAAAGAAATTTATTAAAACAATCTGTAATCGCTGTGTTAGTAGGTGGTGCAGTTTCTGGTTCCGTTTTGGCAAAAAA
TATTGATACAGACAACAAGGATAGTACAAATTTTACTAAGGGTATTCGAAATTCAATTGTTGTTGCTATTCAAGGAAATT
TGCAAATTTTAAATGGCTTTAAAAAAGGAGAAGAAATTCTTGCTGTTAATGATAATAATAAGCTTGAAAAAAGAGACGCA
ACTGATGATGATGTAAATTCAGATCCATTGAAAGGCAAAGGGGTTGTGAACTCTGTTTTAGAAAACCAAGCTGACATTGC
AACTCACACTCAACGTCTTGATAATTTAGATAACAGAGTAAATAACCTTAATAAAGATCTTAAACGTGGTCTTGCTGCTC
AAGCTGCATTAAATGGTTTATTCCAACCGTATAACGTAGGTAAATTAAATCTTACTGCTGCTGTAGGTGGTTATAAATCT
CAAACTGCGGTTGCTGTAGGTACTGGTTATCGTCATAACGAAAATGTCGCGACTAAAGCAGGTGTTGCTTTCACTCATGG
TGGCAGCGCAACTTATAATGTTGGCGTAAATTTTGAATGGTAA

Upstream 100 bases:

>100_bases
CTCAGTTATGGTTATGGTTATGGTTATGGTTATGGTTACATAGTATAGTTTTATTTTGTTCTAGTTCACTTTAATAACCT
TAAATAATTGAGGATTTCTT

Downstream 100 bases:

>100_bases
TTAGATAACTAATTTTCCATAACAGAAAATAAATACCTGTTTTTGAGTAATATCAGAAACAGGTATTTTTTTATAGGCTT
CGTTTCGCACACTCGTTACT

Product: thiamine-phosphate pyrophosphorylase

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 200; Mature: 200

Protein sequence:

>200_residues
MKRNLLKQSVIAVLVGGAVSGSVLAKNIDTDNKDSTNFTKGIRNSIVVAIQGNLQILNGFKKGEEILAVNDNNKLEKRDA
TDDDVNSDPLKGKGVVNSVLENQADIATHTQRLDNLDNRVNNLNKDLKRGLAAQAALNGLFQPYNVGKLNLTAAVGGYKS
QTAVAVGTGYRHNENVATKAGVAFTHGGSATYNVGVNFEW

Sequences:

>Translated_200_residues
MKRNLLKQSVIAVLVGGAVSGSVLAKNIDTDNKDSTNFTKGIRNSIVVAIQGNLQILNGFKKGEEILAVNDNNKLEKRDA
TDDDVNSDPLKGKGVVNSVLENQADIATHTQRLDNLDNRVNNLNKDLKRGLAAQAALNGLFQPYNVGKLNLTAAVGGYKS
QTAVAVGTGYRHNENVATKAGVAFTHGGSATYNVGVNFEW
>Mature_200_residues
MKRNLLKQSVIAVLVGGAVSGSVLAKNIDTDNKDSTNFTKGIRNSIVVAIQGNLQILNGFKKGEEILAVNDNNKLEKRDA
TDDDVNSDPLKGKGVVNSVLENQADIATHTQRLDNLDNRVNNLNKDLKRGLAAQAALNGLFQPYNVGKLNLTAAVGGYKS
QTAVAVGTGYRHNENVATKAGVAFTHGGSATYNVGVNFEW

Specific function: Collagen-binding outer membrane protein forming a fibrillar matrix on the bacterial cell surface. Promotes attachment to eukaryotic cells and after invasion, is the major adhesin in infected tissue. Constitutes an alternative uptake pathway under conditio

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cell outer membrane [H]

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Belongs to the autotransporter-2 (TC 1.B.40) / oligomeric coiled-coil adhesin (Oca) family [H]

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR008640
- InterPro:   IPR008635
- InterPro:   IPR008126
- InterPro:   IPR005594 [H]

Pfam domain/function: PF05658 Hep_Hag; PF05662 HIM; PF03895 YadA [H]

EC number: NA

Molecular weight: Translated: 21319; Mature: 21319

Theoretical pI: Translated: 9.85; Mature: 9.85

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.0 %Cys     (Translated Protein)
0.5 %Met     (Translated Protein)
0.5 %Cys+Met (Translated Protein)
0.0 %Cys     (Mature Protein)
0.5 %Met     (Mature Protein)
0.5 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKRNLLKQSVIAVLVGGAVSGSVLAKNIDTDNKDSTNFTKGIRNSIVVAIQGNLQILNGF
CCCHHHHHHHHHHHHCCCCCCCEEEECCCCCCCCCCHHHHHCCCCEEEEEECCEEEECCC
KKGEEILAVNDNNKLEKRDATDDDVNSDPLKGKGVVNSVLENQADIATHTQRLDNLDNRV
CCCCEEEEECCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHCCHHHHHHHHHHHHHHHHH
NNLNKDLKRGLAAQAALNGLFQPYNVGKLNLTAAVGGYKSQTAVAVGTGYRHNENVATKA
HHHHHHHHHHHHHHHHHHHCCCCCCCCEEEEEEEECCCCCCEEEEEECCCCCCCCCCHHC
GVAFTHGGSATYNVGVNFEW
CEEEECCCCEEEEEEEEECC
>Mature Secondary Structure
MKRNLLKQSVIAVLVGGAVSGSVLAKNIDTDNKDSTNFTKGIRNSIVVAIQGNLQILNGF
CCCHHHHHHHHHHHHCCCCCCCEEEECCCCCCCCCCHHHHHCCCCEEEEEECCEEEECCC
KKGEEILAVNDNNKLEKRDATDDDVNSDPLKGKGVVNSVLENQADIATHTQRLDNLDNRV
CCCCEEEEECCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHCCHHHHHHHHHHHHHHHHH
NNLNKDLKRGLAAQAALNGLFQPYNVGKLNLTAAVGGYKSQTAVAVGTGYRHNENVATKA
HHHHHHHHHHHHHHHHHHHCCCCCCCCEEEEEEEECCCCCCEEEEEECCCCCCCCCCHHC
GVAFTHGGSATYNVGVNFEW
CEEEECCCCEEEEEEEEECC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 7.0

TargetDB status: NA

Availability: NA

References: 3043229; 2761389; 2592347; 1548243; 12183532 [H]