Definition Salmonella enterica subsp. enterica serovar Typhi str. Ty2 chromosome, complete genome.
Accession NC_004631
Length 4,791,961

Click here to switch to the map view.

The map label for this gene is sspH [H]

Identifier: 29141135

GI number: 29141135

Start: 704510

End: 706876

Strand: Direct

Name: sspH [H]

Synonym: t0623

Alternate gene names: 29141135

Gene position: 704510-706876 (Clockwise)

Preceding gene: 29141133

Following gene: 29141138

Centisome position: 14.7

GC content: 55.43

Gene sequence:

>2367_bases
ATGCCCTTTCATATTGGAAGCGGATGTCTTCCCGCCACCATCAGTAATCGCCGCATTTATCGTATTGCCTGGTCTGATAC
CCCCCCTGAAATGAGTTCCTGGGAAAAAATGAAGGAATTTTTTTGCTCAACGCACCAGACTGAAGCGCTGGAGTGCATCT
GGACGATTTGTCACCCGCCGGCCGGAACGACGCGGGAGGATGTGATCAACAGATTTGAACTGCTCAGGACGCTCGCGTAT
GCCGGATGGGAGGAAAGCATTCATTCCGGCCAGCACGGGGAAAATTACTTCTGTATTCTGGATGAAGACAGTCAGGAGAT
ATTGTCAGTCACCCTTGATGATGCCGGGAACTATACCGTAAATTGCCAGGGGTACAGTGAAACACATCGCCTCACCCTGG
ACACAGCACAGGGTGAGGAGGGCACAGGACACGCGGAAGGGGCATCCGGGACATTCAGGACATCCTTCCTCCCTGCCACA
ACGGCTCCACAGACGCCAGCAGAGTATGATGCTGTCTGGTCAGCGTGGAGAAGGGCTGCACCCGCAGAAGAGTCACGCGG
CCGTGCAGCAGCGGTACAGAAAATGCGTGCCTGCCTGAATAATGGCAATGCAGTGCTTAACGTGGGAGAATCAGGTCTTA
CCACCTTGCCAGACTGTTTACCCGCGCATATTACCACACTGGTTATTCCTGATAATAATCTGACCAGCCTGCCGGCGCTG
CCGCCAGAACTGCGGACGCTGGAGGTCTCTGGTAACCAGCTGACTAGCCTGCCGGTGCTGCCGCCAGGACTACTGGAACT
GTCGATCTTTAGTAACCCGCTGACCCACCTGCCGGCGCTGCCGTCAGGACTATGTAAGCTGTGGATCTTTGGTAATCAAC
TGACCAGCCTGCCGGTGTTGCCGCCAGGGCTACAGGAGCTGTCGGTATCTGATAACCAACTGGCCAGCCTGCCGGCGCTG
CCGTCAGAATTATGTAAGCTGTGGGCCTATAATAACCAGCTGACCAGCCTGCCGACGTTGCCGTCAGGGCTACAGGAGCT
GTCGGTATCTGATAACCAACTGGCCAGCTTGCCGACGCTGCCGTCAGAATTATATAAGCTGTGGGCCTATAATAATCGGC
TGACCAGCCTGCCGGCGTTGCCGTCAGGACTGAAGGAGCTGATTGTATCTGGTAACCGGCTGACCAGTCTGCCGGTGCTG
CCGTCAGAACTGAAGGAGCTGATGGTATCTGGTAACCGGCTGACCAGCCTGCCGATGCTGCCGTCAGGACTACTGTCGCT
GTCGGTCTATCGTAACCAGCTGACCCGCCTGCCGGAAAGTCTCATTCATCTGTCTTCAGAGACAACCGTAAATCTGGAAG
GGAACCCACTGTCTGAACGTACTTTGCAGGCGCTGCGGGAGATCACCAGCGCGCCTGGCTATTCAGGCCCCATAATACGA
TTCGATATGGCGGGAGCCTCCGCCCCCCGGGAAACTCGGGCACTGCACCTGGCGGCCGCTGACTGGCTGGTGCCTGCCCG
GGAGGGGGAACCGGCTCCTGCAGACAGATGGCATATGTTCGGACAGGAAGATAACGCCGACGCCTTCAGCCTCTTCCTGG
ACAGACTGAGTGAGACGGAAAACTTCATAAAGGACGCGGGGTTTAAGGCACAGATATCGTCCTGGCTGGCACAACTGGCT
GAAGATGAGGCGTTGAGAGCAAACACCTTTGCTATGGCAACAGAGGCAACCTCAAGCTGCGAGGACCGGGTCACATTTTT
TTTGCACCAGATGAAGAACGTACAGCTGGTACATAATGCAGAAAAAGGGCAATACGATAACGATCTCGCGGCGCTGGTTG
CCACGGGGCGTGAGATGTTCCGTCTGGGAAAACTGGAACAGATTGCCCGGGAAAAGGTCAGAACGCTGGCTCTCGTTGAT
GAAATTGAGGTCTGGCTGGCGTATCAGAATAAGCTGAAGAAATCACTCGGGCTGACCAGCGTGACGTCAGAAATGCGTTT
CTTTGACGTATCCGGCGTGACGGTTACAGACCTTCAGGACGCGGAGCTTCAGGTGAAAGCCGCTGAAAAAAGCGAGTTCA
GGGAGTGGATACTGCAGTGGGGGCCGTTACACAGAGTGCTGGAGCGCAAAGCGCCGAAACGCGTTAACGCGCTTCGTGAA
AAGCAAATATCGGATTATGAGGAAACGTACCGGATGCTGTCTGACACAGAGCTGAGACCGTCTGGGCTGGTCGGTAATAC
CGATGCAGAGCGCACTATCGGAGCAAGAGCGATGGAGAGCGCGAAAAAGACATTTTTGGATGGCCTGCGACCTCTTGTGG
AGGAGATGCTGGGGAGCTATCTGAACGTTCAGTGGCGTCGTAACTGA

Upstream 100 bases:

>100_bases
GACCATGAATCCGCCGATAACCTTATTGTGAAATTAAGACCAGGAAGAGATGATGTCTGCCGGACAGATACTATATGTAA
ATTTATAAAGGTTTTTTGTT

Downstream 100 bases:

>100_bases
TGCACCAGGTGAATGAGGTGCGGTGCGACAAAGATATTCCCGGACGAACAACATCAGACAGTACGGATGATGTACAGGTG
AAATAGGGGAGACTTCTTCA

Product: secreted effector protein

Products: NA

Alternate protein names: Salmonella secreted protein H2; Secreted effector protein sspH2 [H]

Number of amino acids: Translated: 788; Mature: 787

Protein sequence:

>788_residues
MPFHIGSGCLPATISNRRIYRIAWSDTPPEMSSWEKMKEFFCSTHQTEALECIWTICHPPAGTTREDVINRFELLRTLAY
AGWEESIHSGQHGENYFCILDEDSQEILSVTLDDAGNYTVNCQGYSETHRLTLDTAQGEEGTGHAEGASGTFRTSFLPAT
TAPQTPAEYDAVWSAWRRAAPAEESRGRAAAVQKMRACLNNGNAVLNVGESGLTTLPDCLPAHITTLVIPDNNLTSLPAL
PPELRTLEVSGNQLTSLPVLPPGLLELSIFSNPLTHLPALPSGLCKLWIFGNQLTSLPVLPPGLQELSVSDNQLASLPAL
PSELCKLWAYNNQLTSLPTLPSGLQELSVSDNQLASLPTLPSELYKLWAYNNRLTSLPALPSGLKELIVSGNRLTSLPVL
PSELKELMVSGNRLTSLPMLPSGLLSLSVYRNQLTRLPESLIHLSSETTVNLEGNPLSERTLQALREITSAPGYSGPIIR
FDMAGASAPRETRALHLAAADWLVPAREGEPAPADRWHMFGQEDNADAFSLFLDRLSETENFIKDAGFKAQISSWLAQLA
EDEALRANTFAMATEATSSCEDRVTFFLHQMKNVQLVHNAEKGQYDNDLAALVATGREMFRLGKLEQIAREKVRTLALVD
EIEVWLAYQNKLKKSLGLTSVTSEMRFFDVSGVTVTDLQDAELQVKAAEKSEFREWILQWGPLHRVLERKAPKRVNALRE
KQISDYEETYRMLSDTELRPSGLVGNTDAERTIGARAMESAKKTFLDGLRPLVEEMLGSYLNVQWRRN

Sequences:

>Translated_788_residues
MPFHIGSGCLPATISNRRIYRIAWSDTPPEMSSWEKMKEFFCSTHQTEALECIWTICHPPAGTTREDVINRFELLRTLAY
AGWEESIHSGQHGENYFCILDEDSQEILSVTLDDAGNYTVNCQGYSETHRLTLDTAQGEEGTGHAEGASGTFRTSFLPAT
TAPQTPAEYDAVWSAWRRAAPAEESRGRAAAVQKMRACLNNGNAVLNVGESGLTTLPDCLPAHITTLVIPDNNLTSLPAL
PPELRTLEVSGNQLTSLPVLPPGLLELSIFSNPLTHLPALPSGLCKLWIFGNQLTSLPVLPPGLQELSVSDNQLASLPAL
PSELCKLWAYNNQLTSLPTLPSGLQELSVSDNQLASLPTLPSELYKLWAYNNRLTSLPALPSGLKELIVSGNRLTSLPVL
PSELKELMVSGNRLTSLPMLPSGLLSLSVYRNQLTRLPESLIHLSSETTVNLEGNPLSERTLQALREITSAPGYSGPIIR
FDMAGASAPRETRALHLAAADWLVPAREGEPAPADRWHMFGQEDNADAFSLFLDRLSETENFIKDAGFKAQISSWLAQLA
EDEALRANTFAMATEATSSCEDRVTFFLHQMKNVQLVHNAEKGQYDNDLAALVATGREMFRLGKLEQIAREKVRTLALVD
EIEVWLAYQNKLKKSLGLTSVTSEMRFFDVSGVTVTDLQDAELQVKAAEKSEFREWILQWGPLHRVLERKAPKRVNALRE
KQISDYEETYRMLSDTELRPSGLVGNTDAERTIGARAMESAKKTFLDGLRPLVEEMLGSYLNVQWRRN
>Mature_787_residues
PFHIGSGCLPATISNRRIYRIAWSDTPPEMSSWEKMKEFFCSTHQTEALECIWTICHPPAGTTREDVINRFELLRTLAYA
GWEESIHSGQHGENYFCILDEDSQEILSVTLDDAGNYTVNCQGYSETHRLTLDTAQGEEGTGHAEGASGTFRTSFLPATT
APQTPAEYDAVWSAWRRAAPAEESRGRAAAVQKMRACLNNGNAVLNVGESGLTTLPDCLPAHITTLVIPDNNLTSLPALP
PELRTLEVSGNQLTSLPVLPPGLLELSIFSNPLTHLPALPSGLCKLWIFGNQLTSLPVLPPGLQELSVSDNQLASLPALP
SELCKLWAYNNQLTSLPTLPSGLQELSVSDNQLASLPTLPSELYKLWAYNNRLTSLPALPSGLKELIVSGNRLTSLPVLP
SELKELMVSGNRLTSLPMLPSGLLSLSVYRNQLTRLPESLIHLSSETTVNLEGNPLSERTLQALREITSAPGYSGPIIRF
DMAGASAPRETRALHLAAADWLVPAREGEPAPADRWHMFGQEDNADAFSLFLDRLSETENFIKDAGFKAQISSWLAQLAE
DEALRANTFAMATEATSSCEDRVTFFLHQMKNVQLVHNAEKGQYDNDLAALVATGREMFRLGKLEQIAREKVRTLALVDE
IEVWLAYQNKLKKSLGLTSVTSEMRFFDVSGVTVTDLQDAELQVKAAEKSEFREWILQWGPLHRVLERKAPKRVNALREK
QISDYEETYRMLSDTELRPSGLVGNTDAERTIGARAMESAKKTFLDGLRPLVEEMLGSYLNVQWRRN

Specific function: Effector proteins function to alter host cell physiology and promote bacterial survival in host tissues. This protein is an E3 ubiquitin ligase that interferes with host's ubiquitination pathway. Contributes to virulence in calves [H]

COG id: COG4886

COG function: function code S; Leucine-rich repeat (LRR) protein

Gene ontology:

Cell location: Secreted. Host cytoplasm. Host apical cell membrane; Peripheral membrane protein; Cytoplasmic side. Note=Secreted via type III secretion system 2 (SPI-2 TTSS), and delivered into the host cytoplasm. Localizes at the periphery of the host cell, specificall

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 12 LRR (leucine-rich) repeats [H]

Homologues:

Organism=Homo sapiens, GI110825984, Length=310, Percent_Identity=33.8709677419355, Blast_Score=78, Evalue=3e-14,
Organism=Homo sapiens, GI95113664, Length=300, Percent_Identity=31.3333333333333, Blast_Score=68, Evalue=4e-11,
Organism=Caenorhabditis elegans, GI17536887, Length=223, Percent_Identity=41.2556053811659, Blast_Score=85, Evalue=1e-16,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR001611 [H]

Pfam domain/function: PF00560 LRR_1 [H]

EC number: NA

Molecular weight: Translated: 87165; Mature: 87034

Theoretical pI: Translated: 4.92; Mature: 4.92

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.4 %Cys     (Translated Protein)
1.9 %Met     (Translated Protein)
3.3 %Cys+Met (Translated Protein)
1.4 %Cys     (Mature Protein)
1.8 %Met     (Mature Protein)
3.2 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MPFHIGSGCLPATISNRRIYRIAWSDTPPEMSSWEKMKEFFCSTHQTEALECIWTICHPP
CCCCCCCCCCCCEECCCEEEEEEECCCCCCHHHHHHHHHHHHCCCCHHHHHHHHHHHCCC
AGTTREDVINRFELLRTLAYAGWEESIHSGQHGENYFCILDEDSQEILSVTLDDAGNYTV
CCCCHHHHHHHHHHHHHHHHCCHHHHHCCCCCCCCEEEEECCCCCEEEEEEECCCCCEEE
NCQGYSETHRLTLDTAQGEEGTGHAEGASGTFRTSFLPATTAPQTPAEYDAVWSAWRRAA
EECCCCCCCEEEEECCCCCCCCCCCCCCCCCEEEEECCCCCCCCCCHHHHHHHHHHHHCC
PAEESRGRAAAVQKMRACLNNGNAVLNVGESGLTTLPDCLPAHITTLVIPDNNLTSLPAL
CCHHHCCHHHHHHHHHHHHCCCCEEEEECCCCCCCCHHHHHCCEEEEEECCCCCCCCCCC
PPELRTLEVSGNQLTSLPVLPPGLLELSIFSNPLTHLPALPSGLCKLWIFGNQLTSLPVL
CCCCEEEEECCCCEEECCCCCCCCEEEEHHCCCHHHCCCCCHHHEEEEEECCCCCCCCCC
PPGLQELSVSDNQLASLPALPSELCKLWAYNNQLTSLPTLPSGLQELSVSDNQLASLPTL
CCCHHHCCCCCCHHHHCCCCHHHHHHHHHCCCCCCCCCCCCCCHHHHCCCCCHHHCCCCC
PSELYKLWAYNNRLTSLPALPSGLKELIVSGNRLTSLPVLPSELKELMVSGNRLTSLPML
HHHHHHHHHHCCCCCCCCCCHHHHHHHHHCCCCEEECCCCHHHHHHHHHCCCCEEECCCC
PSGLLSLSVYRNQLTRLPESLIHLSSETTVNLEGNPLSERTLQALREITSAPGYSGPIIR
CHHHHHHHHHHHHHHHHHHHHHHCCCCCEEEECCCCCHHHHHHHHHHHHCCCCCCCCEEE
FDMAGASAPRETRALHLAAADWLVPAREGEPAPADRWHMFGQEDNADAFSLFLDRLSETE
EECCCCCCCCHHHEEEEEHHHHEEECCCCCCCCCHHHHCCCCCCCCHHHHHHHHHHHHHH
NFIKDAGFKAQISSWLAQLAEDEALRANTFAMATEATSSCEDRVTFFLHQMKNVQLVHNA
HHHHHCCCHHHHHHHHHHHHHCHHHHHHHHEEEHHHHHHHHHHHHHHHHHHCCEEEEECC
EKGQYDNDLAALVATGREMFRLGKLEQIAREKVRTLALVDEIEVWLAYQNKLKKSLGLTS
CCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHH
VTSEMRFFDVSGVTVTDLQDAELQVKAAEKSEFREWILQWGPLHRVLERKAPKRVNALRE
HHHCCEEEECCCCEEECCCCCCEEEEHHHHHHHHHHHHHCCHHHHHHHHCCCHHHHHHHH
KQISDYEETYRMLSDTELRPSGLVGNTDAERTIGARAMESAKKTFLDGLRPLVEEMLGSY
HHHHHHHHHHHHHHCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
LNVQWRRN
CCEEEECC
>Mature Secondary Structure 
PFHIGSGCLPATISNRRIYRIAWSDTPPEMSSWEKMKEFFCSTHQTEALECIWTICHPP
CCCCCCCCCCCEECCCEEEEEEECCCCCCHHHHHHHHHHHHCCCCHHHHHHHHHHHCCC
AGTTREDVINRFELLRTLAYAGWEESIHSGQHGENYFCILDEDSQEILSVTLDDAGNYTV
CCCCHHHHHHHHHHHHHHHHCCHHHHHCCCCCCCCEEEEECCCCCEEEEEEECCCCCEEE
NCQGYSETHRLTLDTAQGEEGTGHAEGASGTFRTSFLPATTAPQTPAEYDAVWSAWRRAA
EECCCCCCCEEEEECCCCCCCCCCCCCCCCCEEEEECCCCCCCCCCHHHHHHHHHHHHCC
PAEESRGRAAAVQKMRACLNNGNAVLNVGESGLTTLPDCLPAHITTLVIPDNNLTSLPAL
CCHHHCCHHHHHHHHHHHHCCCCEEEEECCCCCCCCHHHHHCCEEEEEECCCCCCCCCCC
PPELRTLEVSGNQLTSLPVLPPGLLELSIFSNPLTHLPALPSGLCKLWIFGNQLTSLPVL
CCCCEEEEECCCCEEECCCCCCCCEEEEHHCCCHHHCCCCCHHHEEEEEECCCCCCCCCC
PPGLQELSVSDNQLASLPALPSELCKLWAYNNQLTSLPTLPSGLQELSVSDNQLASLPTL
CCCHHHCCCCCCHHHHCCCCHHHHHHHHHCCCCCCCCCCCCCCHHHHCCCCCHHHCCCCC
PSELYKLWAYNNRLTSLPALPSGLKELIVSGNRLTSLPVLPSELKELMVSGNRLTSLPML
HHHHHHHHHHCCCCCCCCCCHHHHHHHHHCCCCEEECCCCHHHHHHHHHCCCCEEECCCC
PSGLLSLSVYRNQLTRLPESLIHLSSETTVNLEGNPLSERTLQALREITSAPGYSGPIIR
CHHHHHHHHHHHHHHHHHHHHHHCCCCCEEEECCCCCHHHHHHHHHHHHCCCCCCCCEEE
FDMAGASAPRETRALHLAAADWLVPAREGEPAPADRWHMFGQEDNADAFSLFLDRLSETE
EECCCCCCCCHHHEEEEEHHHHEEECCCCCCCCCHHHHCCCCCCCCHHHHHHHHHHHHHH
NFIKDAGFKAQISSWLAQLAEDEALRANTFAMATEATSSCEDRVTFFLHQMKNVQLVHNA
HHHHHCCCHHHHHHHHHHHHHCHHHHHHHHEEEHHHHHHHHHHHHHHHHHHCCEEEEECC
EKGQYDNDLAALVATGREMFRLGKLEQIAREKVRTLALVDEIEVWLAYQNKLKKSLGLTS
CCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHH
VTSEMRFFDVSGVTVTDLQDAELQVKAAEKSEFREWILQWGPLHRVLERKAPKRVNALRE
HHHCCEEEECCCCEEECCCCCCEEEEHHHHHHHHHHHHHCCHHHHHHHHCCCHHHHHHHH
KQISDYEETYRMLSDTELRPSGLVGNTDAERTIGARAMESAKKTFLDGLRPLVEEMLGSY
HHHHHHHHHHHHHHCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
LNVQWRRN
CCEEEECC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 10564523; 10861017 [H]