| Definition | Salmonella enterica subsp. enterica serovar Typhi str. Ty2 chromosome, complete genome. |
|---|---|
| Accession | NC_004631 |
| Length | 4,791,961 |
Click here to switch to the map view.
The map label for this gene is sspH [H]
Identifier: 29141135
GI number: 29141135
Start: 704510
End: 706876
Strand: Direct
Name: sspH [H]
Synonym: t0623
Alternate gene names: 29141135
Gene position: 704510-706876 (Clockwise)
Preceding gene: 29141133
Following gene: 29141138
Centisome position: 14.7
GC content: 55.43
Gene sequence:
>2367_bases ATGCCCTTTCATATTGGAAGCGGATGTCTTCCCGCCACCATCAGTAATCGCCGCATTTATCGTATTGCCTGGTCTGATAC CCCCCCTGAAATGAGTTCCTGGGAAAAAATGAAGGAATTTTTTTGCTCAACGCACCAGACTGAAGCGCTGGAGTGCATCT GGACGATTTGTCACCCGCCGGCCGGAACGACGCGGGAGGATGTGATCAACAGATTTGAACTGCTCAGGACGCTCGCGTAT GCCGGATGGGAGGAAAGCATTCATTCCGGCCAGCACGGGGAAAATTACTTCTGTATTCTGGATGAAGACAGTCAGGAGAT ATTGTCAGTCACCCTTGATGATGCCGGGAACTATACCGTAAATTGCCAGGGGTACAGTGAAACACATCGCCTCACCCTGG ACACAGCACAGGGTGAGGAGGGCACAGGACACGCGGAAGGGGCATCCGGGACATTCAGGACATCCTTCCTCCCTGCCACA ACGGCTCCACAGACGCCAGCAGAGTATGATGCTGTCTGGTCAGCGTGGAGAAGGGCTGCACCCGCAGAAGAGTCACGCGG CCGTGCAGCAGCGGTACAGAAAATGCGTGCCTGCCTGAATAATGGCAATGCAGTGCTTAACGTGGGAGAATCAGGTCTTA CCACCTTGCCAGACTGTTTACCCGCGCATATTACCACACTGGTTATTCCTGATAATAATCTGACCAGCCTGCCGGCGCTG CCGCCAGAACTGCGGACGCTGGAGGTCTCTGGTAACCAGCTGACTAGCCTGCCGGTGCTGCCGCCAGGACTACTGGAACT GTCGATCTTTAGTAACCCGCTGACCCACCTGCCGGCGCTGCCGTCAGGACTATGTAAGCTGTGGATCTTTGGTAATCAAC TGACCAGCCTGCCGGTGTTGCCGCCAGGGCTACAGGAGCTGTCGGTATCTGATAACCAACTGGCCAGCCTGCCGGCGCTG CCGTCAGAATTATGTAAGCTGTGGGCCTATAATAACCAGCTGACCAGCCTGCCGACGTTGCCGTCAGGGCTACAGGAGCT GTCGGTATCTGATAACCAACTGGCCAGCTTGCCGACGCTGCCGTCAGAATTATATAAGCTGTGGGCCTATAATAATCGGC TGACCAGCCTGCCGGCGTTGCCGTCAGGACTGAAGGAGCTGATTGTATCTGGTAACCGGCTGACCAGTCTGCCGGTGCTG CCGTCAGAACTGAAGGAGCTGATGGTATCTGGTAACCGGCTGACCAGCCTGCCGATGCTGCCGTCAGGACTACTGTCGCT GTCGGTCTATCGTAACCAGCTGACCCGCCTGCCGGAAAGTCTCATTCATCTGTCTTCAGAGACAACCGTAAATCTGGAAG GGAACCCACTGTCTGAACGTACTTTGCAGGCGCTGCGGGAGATCACCAGCGCGCCTGGCTATTCAGGCCCCATAATACGA TTCGATATGGCGGGAGCCTCCGCCCCCCGGGAAACTCGGGCACTGCACCTGGCGGCCGCTGACTGGCTGGTGCCTGCCCG GGAGGGGGAACCGGCTCCTGCAGACAGATGGCATATGTTCGGACAGGAAGATAACGCCGACGCCTTCAGCCTCTTCCTGG ACAGACTGAGTGAGACGGAAAACTTCATAAAGGACGCGGGGTTTAAGGCACAGATATCGTCCTGGCTGGCACAACTGGCT GAAGATGAGGCGTTGAGAGCAAACACCTTTGCTATGGCAACAGAGGCAACCTCAAGCTGCGAGGACCGGGTCACATTTTT TTTGCACCAGATGAAGAACGTACAGCTGGTACATAATGCAGAAAAAGGGCAATACGATAACGATCTCGCGGCGCTGGTTG CCACGGGGCGTGAGATGTTCCGTCTGGGAAAACTGGAACAGATTGCCCGGGAAAAGGTCAGAACGCTGGCTCTCGTTGAT GAAATTGAGGTCTGGCTGGCGTATCAGAATAAGCTGAAGAAATCACTCGGGCTGACCAGCGTGACGTCAGAAATGCGTTT CTTTGACGTATCCGGCGTGACGGTTACAGACCTTCAGGACGCGGAGCTTCAGGTGAAAGCCGCTGAAAAAAGCGAGTTCA GGGAGTGGATACTGCAGTGGGGGCCGTTACACAGAGTGCTGGAGCGCAAAGCGCCGAAACGCGTTAACGCGCTTCGTGAA AAGCAAATATCGGATTATGAGGAAACGTACCGGATGCTGTCTGACACAGAGCTGAGACCGTCTGGGCTGGTCGGTAATAC CGATGCAGAGCGCACTATCGGAGCAAGAGCGATGGAGAGCGCGAAAAAGACATTTTTGGATGGCCTGCGACCTCTTGTGG AGGAGATGCTGGGGAGCTATCTGAACGTTCAGTGGCGTCGTAACTGA
Upstream 100 bases:
>100_bases GACCATGAATCCGCCGATAACCTTATTGTGAAATTAAGACCAGGAAGAGATGATGTCTGCCGGACAGATACTATATGTAA ATTTATAAAGGTTTTTTGTT
Downstream 100 bases:
>100_bases TGCACCAGGTGAATGAGGTGCGGTGCGACAAAGATATTCCCGGACGAACAACATCAGACAGTACGGATGATGTACAGGTG AAATAGGGGAGACTTCTTCA
Product: secreted effector protein
Products: NA
Alternate protein names: Salmonella secreted protein H2; Secreted effector protein sspH2 [H]
Number of amino acids: Translated: 788; Mature: 787
Protein sequence:
>788_residues MPFHIGSGCLPATISNRRIYRIAWSDTPPEMSSWEKMKEFFCSTHQTEALECIWTICHPPAGTTREDVINRFELLRTLAY AGWEESIHSGQHGENYFCILDEDSQEILSVTLDDAGNYTVNCQGYSETHRLTLDTAQGEEGTGHAEGASGTFRTSFLPAT TAPQTPAEYDAVWSAWRRAAPAEESRGRAAAVQKMRACLNNGNAVLNVGESGLTTLPDCLPAHITTLVIPDNNLTSLPAL PPELRTLEVSGNQLTSLPVLPPGLLELSIFSNPLTHLPALPSGLCKLWIFGNQLTSLPVLPPGLQELSVSDNQLASLPAL PSELCKLWAYNNQLTSLPTLPSGLQELSVSDNQLASLPTLPSELYKLWAYNNRLTSLPALPSGLKELIVSGNRLTSLPVL PSELKELMVSGNRLTSLPMLPSGLLSLSVYRNQLTRLPESLIHLSSETTVNLEGNPLSERTLQALREITSAPGYSGPIIR FDMAGASAPRETRALHLAAADWLVPAREGEPAPADRWHMFGQEDNADAFSLFLDRLSETENFIKDAGFKAQISSWLAQLA EDEALRANTFAMATEATSSCEDRVTFFLHQMKNVQLVHNAEKGQYDNDLAALVATGREMFRLGKLEQIAREKVRTLALVD EIEVWLAYQNKLKKSLGLTSVTSEMRFFDVSGVTVTDLQDAELQVKAAEKSEFREWILQWGPLHRVLERKAPKRVNALRE KQISDYEETYRMLSDTELRPSGLVGNTDAERTIGARAMESAKKTFLDGLRPLVEEMLGSYLNVQWRRN
Sequences:
>Translated_788_residues MPFHIGSGCLPATISNRRIYRIAWSDTPPEMSSWEKMKEFFCSTHQTEALECIWTICHPPAGTTREDVINRFELLRTLAY AGWEESIHSGQHGENYFCILDEDSQEILSVTLDDAGNYTVNCQGYSETHRLTLDTAQGEEGTGHAEGASGTFRTSFLPAT TAPQTPAEYDAVWSAWRRAAPAEESRGRAAAVQKMRACLNNGNAVLNVGESGLTTLPDCLPAHITTLVIPDNNLTSLPAL PPELRTLEVSGNQLTSLPVLPPGLLELSIFSNPLTHLPALPSGLCKLWIFGNQLTSLPVLPPGLQELSVSDNQLASLPAL PSELCKLWAYNNQLTSLPTLPSGLQELSVSDNQLASLPTLPSELYKLWAYNNRLTSLPALPSGLKELIVSGNRLTSLPVL PSELKELMVSGNRLTSLPMLPSGLLSLSVYRNQLTRLPESLIHLSSETTVNLEGNPLSERTLQALREITSAPGYSGPIIR FDMAGASAPRETRALHLAAADWLVPAREGEPAPADRWHMFGQEDNADAFSLFLDRLSETENFIKDAGFKAQISSWLAQLA EDEALRANTFAMATEATSSCEDRVTFFLHQMKNVQLVHNAEKGQYDNDLAALVATGREMFRLGKLEQIAREKVRTLALVD EIEVWLAYQNKLKKSLGLTSVTSEMRFFDVSGVTVTDLQDAELQVKAAEKSEFREWILQWGPLHRVLERKAPKRVNALRE KQISDYEETYRMLSDTELRPSGLVGNTDAERTIGARAMESAKKTFLDGLRPLVEEMLGSYLNVQWRRN >Mature_787_residues PFHIGSGCLPATISNRRIYRIAWSDTPPEMSSWEKMKEFFCSTHQTEALECIWTICHPPAGTTREDVINRFELLRTLAYA GWEESIHSGQHGENYFCILDEDSQEILSVTLDDAGNYTVNCQGYSETHRLTLDTAQGEEGTGHAEGASGTFRTSFLPATT APQTPAEYDAVWSAWRRAAPAEESRGRAAAVQKMRACLNNGNAVLNVGESGLTTLPDCLPAHITTLVIPDNNLTSLPALP PELRTLEVSGNQLTSLPVLPPGLLELSIFSNPLTHLPALPSGLCKLWIFGNQLTSLPVLPPGLQELSVSDNQLASLPALP SELCKLWAYNNQLTSLPTLPSGLQELSVSDNQLASLPTLPSELYKLWAYNNRLTSLPALPSGLKELIVSGNRLTSLPVLP SELKELMVSGNRLTSLPMLPSGLLSLSVYRNQLTRLPESLIHLSSETTVNLEGNPLSERTLQALREITSAPGYSGPIIRF DMAGASAPRETRALHLAAADWLVPAREGEPAPADRWHMFGQEDNADAFSLFLDRLSETENFIKDAGFKAQISSWLAQLAE DEALRANTFAMATEATSSCEDRVTFFLHQMKNVQLVHNAEKGQYDNDLAALVATGREMFRLGKLEQIAREKVRTLALVDE IEVWLAYQNKLKKSLGLTSVTSEMRFFDVSGVTVTDLQDAELQVKAAEKSEFREWILQWGPLHRVLERKAPKRVNALREK QISDYEETYRMLSDTELRPSGLVGNTDAERTIGARAMESAKKTFLDGLRPLVEEMLGSYLNVQWRRN
Specific function: Effector proteins function to alter host cell physiology and promote bacterial survival in host tissues. This protein is an E3 ubiquitin ligase that interferes with host's ubiquitination pathway. Contributes to virulence in calves [H]
COG id: COG4886
COG function: function code S; Leucine-rich repeat (LRR) protein
Gene ontology:
Cell location: Secreted. Host cytoplasm. Host apical cell membrane; Peripheral membrane protein; Cytoplasmic side. Note=Secreted via type III secretion system 2 (SPI-2 TTSS), and delivered into the host cytoplasm. Localizes at the periphery of the host cell, specificall
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 12 LRR (leucine-rich) repeats [H]
Homologues:
Organism=Homo sapiens, GI110825984, Length=310, Percent_Identity=33.8709677419355, Blast_Score=78, Evalue=3e-14, Organism=Homo sapiens, GI95113664, Length=300, Percent_Identity=31.3333333333333, Blast_Score=68, Evalue=4e-11, Organism=Caenorhabditis elegans, GI17536887, Length=223, Percent_Identity=41.2556053811659, Blast_Score=85, Evalue=1e-16,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR001611 [H]
Pfam domain/function: PF00560 LRR_1 [H]
EC number: NA
Molecular weight: Translated: 87165; Mature: 87034
Theoretical pI: Translated: 4.92; Mature: 4.92
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.4 %Cys (Translated Protein) 1.9 %Met (Translated Protein) 3.3 %Cys+Met (Translated Protein) 1.4 %Cys (Mature Protein) 1.8 %Met (Mature Protein) 3.2 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MPFHIGSGCLPATISNRRIYRIAWSDTPPEMSSWEKMKEFFCSTHQTEALECIWTICHPP CCCCCCCCCCCCEECCCEEEEEEECCCCCCHHHHHHHHHHHHCCCCHHHHHHHHHHHCCC AGTTREDVINRFELLRTLAYAGWEESIHSGQHGENYFCILDEDSQEILSVTLDDAGNYTV CCCCHHHHHHHHHHHHHHHHCCHHHHHCCCCCCCCEEEEECCCCCEEEEEEECCCCCEEE NCQGYSETHRLTLDTAQGEEGTGHAEGASGTFRTSFLPATTAPQTPAEYDAVWSAWRRAA EECCCCCCCEEEEECCCCCCCCCCCCCCCCCEEEEECCCCCCCCCCHHHHHHHHHHHHCC PAEESRGRAAAVQKMRACLNNGNAVLNVGESGLTTLPDCLPAHITTLVIPDNNLTSLPAL CCHHHCCHHHHHHHHHHHHCCCCEEEEECCCCCCCCHHHHHCCEEEEEECCCCCCCCCCC PPELRTLEVSGNQLTSLPVLPPGLLELSIFSNPLTHLPALPSGLCKLWIFGNQLTSLPVL CCCCEEEEECCCCEEECCCCCCCCEEEEHHCCCHHHCCCCCHHHEEEEEECCCCCCCCCC PPGLQELSVSDNQLASLPALPSELCKLWAYNNQLTSLPTLPSGLQELSVSDNQLASLPTL CCCHHHCCCCCCHHHHCCCCHHHHHHHHHCCCCCCCCCCCCCCHHHHCCCCCHHHCCCCC PSELYKLWAYNNRLTSLPALPSGLKELIVSGNRLTSLPVLPSELKELMVSGNRLTSLPML HHHHHHHHHHCCCCCCCCCCHHHHHHHHHCCCCEEECCCCHHHHHHHHHCCCCEEECCCC PSGLLSLSVYRNQLTRLPESLIHLSSETTVNLEGNPLSERTLQALREITSAPGYSGPIIR CHHHHHHHHHHHHHHHHHHHHHHCCCCCEEEECCCCCHHHHHHHHHHHHCCCCCCCCEEE FDMAGASAPRETRALHLAAADWLVPAREGEPAPADRWHMFGQEDNADAFSLFLDRLSETE EECCCCCCCCHHHEEEEEHHHHEEECCCCCCCCCHHHHCCCCCCCCHHHHHHHHHHHHHH NFIKDAGFKAQISSWLAQLAEDEALRANTFAMATEATSSCEDRVTFFLHQMKNVQLVHNA HHHHHCCCHHHHHHHHHHHHHCHHHHHHHHEEEHHHHHHHHHHHHHHHHHHCCEEEEECC EKGQYDNDLAALVATGREMFRLGKLEQIAREKVRTLALVDEIEVWLAYQNKLKKSLGLTS CCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHH VTSEMRFFDVSGVTVTDLQDAELQVKAAEKSEFREWILQWGPLHRVLERKAPKRVNALRE HHHCCEEEECCCCEEECCCCCCEEEEHHHHHHHHHHHHHCCHHHHHHHHCCCHHHHHHHH KQISDYEETYRMLSDTELRPSGLVGNTDAERTIGARAMESAKKTFLDGLRPLVEEMLGSY HHHHHHHHHHHHHHCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH LNVQWRRN CCEEEECC >Mature Secondary Structure PFHIGSGCLPATISNRRIYRIAWSDTPPEMSSWEKMKEFFCSTHQTEALECIWTICHPP CCCCCCCCCCCEECCCEEEEEEECCCCCCHHHHHHHHHHHHCCCCHHHHHHHHHHHCCC AGTTREDVINRFELLRTLAYAGWEESIHSGQHGENYFCILDEDSQEILSVTLDDAGNYTV CCCCHHHHHHHHHHHHHHHHCCHHHHHCCCCCCCCEEEEECCCCCEEEEEEECCCCCEEE NCQGYSETHRLTLDTAQGEEGTGHAEGASGTFRTSFLPATTAPQTPAEYDAVWSAWRRAA EECCCCCCCEEEEECCCCCCCCCCCCCCCCCEEEEECCCCCCCCCCHHHHHHHHHHHHCC PAEESRGRAAAVQKMRACLNNGNAVLNVGESGLTTLPDCLPAHITTLVIPDNNLTSLPAL CCHHHCCHHHHHHHHHHHHCCCCEEEEECCCCCCCCHHHHHCCEEEEEECCCCCCCCCCC PPELRTLEVSGNQLTSLPVLPPGLLELSIFSNPLTHLPALPSGLCKLWIFGNQLTSLPVL CCCCEEEEECCCCEEECCCCCCCCEEEEHHCCCHHHCCCCCHHHEEEEEECCCCCCCCCC PPGLQELSVSDNQLASLPALPSELCKLWAYNNQLTSLPTLPSGLQELSVSDNQLASLPTL CCCHHHCCCCCCHHHHCCCCHHHHHHHHHCCCCCCCCCCCCCCHHHHCCCCCHHHCCCCC PSELYKLWAYNNRLTSLPALPSGLKELIVSGNRLTSLPVLPSELKELMVSGNRLTSLPML HHHHHHHHHHCCCCCCCCCCHHHHHHHHHCCCCEEECCCCHHHHHHHHHCCCCEEECCCC PSGLLSLSVYRNQLTRLPESLIHLSSETTVNLEGNPLSERTLQALREITSAPGYSGPIIR CHHHHHHHHHHHHHHHHHHHHHHCCCCCEEEECCCCCHHHHHHHHHHHHCCCCCCCCEEE FDMAGASAPRETRALHLAAADWLVPAREGEPAPADRWHMFGQEDNADAFSLFLDRLSETE EECCCCCCCCHHHEEEEEHHHHEEECCCCCCCCCHHHHCCCCCCCCHHHHHHHHHHHHHH NFIKDAGFKAQISSWLAQLAEDEALRANTFAMATEATSSCEDRVTFFLHQMKNVQLVHNA HHHHHCCCHHHHHHHHHHHHHCHHHHHHHHEEEHHHHHHHHHHHHHHHHHHCCEEEEECC EKGQYDNDLAALVATGREMFRLGKLEQIAREKVRTLALVDEIEVWLAYQNKLKKSLGLTS CCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHH VTSEMRFFDVSGVTVTDLQDAELQVKAAEKSEFREWILQWGPLHRVLERKAPKRVNALRE HHHCCEEEECCCCEEECCCCCCEEEEHHHHHHHHHHHHHCCHHHHHHHHCCCHHHHHHHH KQISDYEETYRMLSDTELRPSGLVGNTDAERTIGARAMESAKKTFLDGLRPLVEEMLGSY HHHHHHHHHHHHHHCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH LNVQWRRN CCEEEECC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 6.0
TargetDB status: NA
Availability: NA
References: 10564523; 10861017 [H]