Definition Salmonella enterica subsp. enterica serovar Typhimurium str. LT2 chromosome, complete genome.
Accession NC_003197
Length 4,857,432

Click here to switch to the map view.

The map label for this gene is 16764096

Identifier: 16764096

GI number: 16764096

Start: 791776

End: 793671

Strand: Direct

Name: 16764096

Synonym: STM0726

Alternate gene names: NA

Gene position: 791776-793671 (Clockwise)

Preceding gene: 16764095

Following gene: 16764097

Centisome position: 16.3

GC content: 35.81

Gene sequence:

>1896_bases
TTGGTTAGCCGGAGGATTTACCGTCCCAGAGATTTGTTTTCATTAATGCAATCAACTTTAGCAACTGAGAAATTTTTTAT
ATCAGCGTACGAGATTGGTATTATTGATAATTTCCCAGAGATAAGAGTTCAGGCGGAAGTAAGTGCCAGAGAGAATAGGG
TCAGGCGTTTTGGCGGCGAGCCGGAAATACTTATATCTGAAATATACGATGAAATTTTAAAAAAGCATCCGCAGCTTTCA
CCAGCGACAGTAAAAAAGATAATCGATCTGGAAATACAAATGGAGAAGATTGTTTTATATAAAAATGCGCGTGGAAGCTG
TTTGTTTGAAAAGGCTATTAGTGATGGTTGCAAAGTCATTTTAATTAGTGACATGTACCTTCCATCAGCAATATTAAAGG
AGTTGTTAACATCATGTGGCTATGATATCAGTAACATTCCAGTTTATTCATCTGGCGAAGAGCGGTACTCTAAAAATAGT
GGTAAATTATTTTCAATAGTCAAGAAAAATGAAAATGTAGATATTGCATCGTGGATGCATGTTGGCGACAATGTTCATGC
TGATATTCTGAATGCTAAAAAACTCGGCATAAATACTCTCCATGCTGATTGGTCAGAGTATAATCATGGGATATCTAATC
ATTGGAAAGCTAAAGATATTATTGGTGAATCTATTTGTAAGACTTTATTACTTAAACAAGTTTCTGCTTTCCATCAAAAT
GATCCTTTAAACGAGATAGGATTTAAAGTATTTGGTCCATTATTATTAGGTTATGTATCCTGGTTAGCGAATCAGTTAAA
GATTCATAAAATTGATAAAGCGCTTTTTTTAGCACGCGATGCTCACTTAATCTATAAAATTTATAATGAATACTTTTCAG
AAGAACATGTAAAATGTGAATATTTATATATATCCCGCGCATCAGCTTATATGGTGGGGATGACTGATTGGCCGATGCAC
AGGATTTGGCATCTTTTTGGTGGTAAGAATAAGAAAAGTATTAAAAAGATACTTGCTATCGCGGGGTTAGATGCGAGTGA
GCATATTTCAGATATACATCATGTTGGTTTTCCTGACGAGGAGTATATTCCTGTTTCAGGAGAGGAACATAAGGTTCACT
GGCTTATAAATAAATTATTTCCATATATTTTATTAAAAAATACTCAGCACAGGGAAGTTTACGCTGATTACTTTAAAACG
GCCTGTGAAGGTTATAAAAATATAGCACTTATCGATGTAGGATGGATGGGTAATATTCAATCAGTATTTGCTCGTTCTTT
AGGTGCGCAATGGGCAGAAAAACAAATACATGGGTTTTATTTGGCAACTTTTGCTGGCGCCAATGATAACCGATCTATTT
ATAATAAGATGTTTGGTTGGCTAACCAACTATGGCCATCCCAACGATAAGTGTGATCTTTTCTTATCAGGAGGGGTGGAA
ATAATGGAGTTCGCTATGGCTGACAATACTGGGTCAACAATTGGCTATAAAAAAACGGATAATGGAATAATTCCTGTACG
TGAAGATAGCAGTGGTTCTGAAATTGAGTATTTAAAAAAAGCAGCAAGATTGCAATCAGGGATTATTTCTTTTTTTGAGT
ACGTCAAACCGCTCATACAAAAAGGAAATTATGCAGCACTTAGTAGTGTTGTATTGTCAGAACCTTTTTTTGAATTGATA
GCCAGACCCTCAAGCGCTCAACTGGACGCCTTATCTTCCCTCACACATTCAGAGTCCGCGGGATCTAACGCAGAAAGAAT
CGTGCTAGCCAAGAAACTGCCTTTAAAGGATAAACTTTTTCCCGGAGAAAATTATATCAAAGAGTTGAATGCCAGTTATT
GGAAAGAAGGCTTTAAAAGGATCAACAGAAAAAAATTTTGGGCAAAATATAACTAA

Upstream 100 bases:

>100_bases
TCTTTTTCATAAAATTTCTTATATTGAAAATAAGATTAAATAAAATATGGATATGAACTTTAAAAAATACAAGACCGTAA
GCTTTGATATCTTTGATACA

Downstream 100 bases:

>100_bases
GCGTCATTTAATTCCGGTAGGCAGACAATCATTATTGGGCGCTCGCCCGACAAGGGCTGAGTCGATTATGCCCTGGCGCG
ATCATGTTAACCCTGACGGG

Product: glycosyl transferase

Products: NA

Alternate protein names: HAD Superfamily Hydrolase-Like Protein; Glycosyl Transferase; Haloacid Dehalogenase Domain-Containing Protein Hydrolase; Hydrolase Protein; Capsule Polysaccharide Biosynthesis Protein; HAD Family Hydrolase; Hydrolase Protein-Like Protein; Hydrolase; Sugar Transferase; Glycosyl Transferase Family Protein; Haloacid Dehalogenase Domain Protein Hydrolase; Glycosyltransferase

Number of amino acids: Translated: 631; Mature: 631

Protein sequence:

>631_residues
MVSRRIYRPRDLFSLMQSTLATEKFFISAYEIGIIDNFPEIRVQAEVSARENRVRRFGGEPEILISEIYDEILKKHPQLS
PATVKKIIDLEIQMEKIVLYKNARGSCLFEKAISDGCKVILISDMYLPSAILKELLTSCGYDISNIPVYSSGEERYSKNS
GKLFSIVKKNENVDIASWMHVGDNVHADILNAKKLGINTLHADWSEYNHGISNHWKAKDIIGESICKTLLLKQVSAFHQN
DPLNEIGFKVFGPLLLGYVSWLANQLKIHKIDKALFLARDAHLIYKIYNEYFSEEHVKCEYLYISRASAYMVGMTDWPMH
RIWHLFGGKNKKSIKKILAIAGLDASEHISDIHHVGFPDEEYIPVSGEEHKVHWLINKLFPYILLKNTQHREVYADYFKT
ACEGYKNIALIDVGWMGNIQSVFARSLGAQWAEKQIHGFYLATFAGANDNRSIYNKMFGWLTNYGHPNDKCDLFLSGGVE
IMEFAMADNTGSTIGYKKTDNGIIPVREDSSGSEIEYLKKAARLQSGIISFFEYVKPLIQKGNYAALSSVVLSEPFFELI
ARPSSAQLDALSSLTHSESAGSNAERIVLAKKLPLKDKLFPGENYIKELNASYWKEGFKRINRKKFWAKYN

Sequences:

>Translated_631_residues
MVSRRIYRPRDLFSLMQSTLATEKFFISAYEIGIIDNFPEIRVQAEVSARENRVRRFGGEPEILISEIYDEILKKHPQLS
PATVKKIIDLEIQMEKIVLYKNARGSCLFEKAISDGCKVILISDMYLPSAILKELLTSCGYDISNIPVYSSGEERYSKNS
GKLFSIVKKNENVDIASWMHVGDNVHADILNAKKLGINTLHADWSEYNHGISNHWKAKDIIGESICKTLLLKQVSAFHQN
DPLNEIGFKVFGPLLLGYVSWLANQLKIHKIDKALFLARDAHLIYKIYNEYFSEEHVKCEYLYISRASAYMVGMTDWPMH
RIWHLFGGKNKKSIKKILAIAGLDASEHISDIHHVGFPDEEYIPVSGEEHKVHWLINKLFPYILLKNTQHREVYADYFKT
ACEGYKNIALIDVGWMGNIQSVFARSLGAQWAEKQIHGFYLATFAGANDNRSIYNKMFGWLTNYGHPNDKCDLFLSGGVE
IMEFAMADNTGSTIGYKKTDNGIIPVREDSSGSEIEYLKKAARLQSGIISFFEYVKPLIQKGNYAALSSVVLSEPFFELI
ARPSSAQLDALSSLTHSESAGSNAERIVLAKKLPLKDKLFPGENYIKELNASYWKEGFKRINRKKFWAKYN
>Mature_631_residues
MVSRRIYRPRDLFSLMQSTLATEKFFISAYEIGIIDNFPEIRVQAEVSARENRVRRFGGEPEILISEIYDEILKKHPQLS
PATVKKIIDLEIQMEKIVLYKNARGSCLFEKAISDGCKVILISDMYLPSAILKELLTSCGYDISNIPVYSSGEERYSKNS
GKLFSIVKKNENVDIASWMHVGDNVHADILNAKKLGINTLHADWSEYNHGISNHWKAKDIIGESICKTLLLKQVSAFHQN
DPLNEIGFKVFGPLLLGYVSWLANQLKIHKIDKALFLARDAHLIYKIYNEYFSEEHVKCEYLYISRASAYMVGMTDWPMH
RIWHLFGGKNKKSIKKILAIAGLDASEHISDIHHVGFPDEEYIPVSGEEHKVHWLINKLFPYILLKNTQHREVYADYFKT
ACEGYKNIALIDVGWMGNIQSVFARSLGAQWAEKQIHGFYLATFAGANDNRSIYNKMFGWLTNYGHPNDKCDLFLSGGVE
IMEFAMADNTGSTIGYKKTDNGIIPVREDSSGSEIEYLKKAARLQSGIISFFEYVKPLIQKGNYAALSSVVLSEPFFELI
ARPSSAQLDALSSLTHSESAGSNAERIVLAKKLPLKDKLFPGENYIKELNASYWKEGFKRINRKKFWAKYN

Specific function: Unknown

COG id: COG5610

COG function: function code R; Predicted hydrolase (HAD superfamily)

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 71856; Mature: 71856

Theoretical pI: Translated: 8.53; Mature: 8.53

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.1 %Cys     (Translated Protein)
1.9 %Met     (Translated Protein)
3.0 %Cys+Met (Translated Protein)
1.1 %Cys     (Mature Protein)
1.9 %Met     (Mature Protein)
3.0 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MVSRRIYRPRDLFSLMQSTLATEKFFISAYEIGIIDNFPEIRVQAEVSARENRVRRFGGE
CCCCCCCCHHHHHHHHHHHHHHHHHEEEEEEEEEECCCCCEEEEEEHHHHHHHHHHCCCC
PEILISEIYDEILKKHPQLSPATVKKIIDLEIQMEKIVLYKNARGSCLFEKAISDGCKVI
CHHHHHHHHHHHHHHCCCCCHHHHHHHHHHEEEEEEEEEEECCCCCCHHHHHHCCCCEEE
LISDMYLPSAILKELLTSCGYDISNIPVYSSGEERYSKNSGKLFSIVKKNENVDIASWMH
EEECCCCCHHHHHHHHHHCCCCCCCCCEECCCHHHHCCCCCCEEEEEECCCCCCHHHHHH
VGDNVHADILNAKKLGINTLHADWSEYNHGISNHWKAKDIIGESICKTLLLKQVSAFHQN
CCCCCCHHHHHHHHCCCCCEECCHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHCC
DPLNEIGFKVFGPLLLGYVSWLANQLKIHKIDKALFLARDAHLIYKIYNEYFSEEHVKCE
CCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCEEE
YLYISRASAYMVGMTDWPMHRIWHLFGGKNKKSIKKILAIAGLDASEHISDIHHVGFPDE
EEEEECCCEEEEECCCCHHHHHHHHHCCCCHHHHHHHHHHHCCCHHHHHHHHHHCCCCCC
EYIPVSGEEHKVHWLINKLFPYILLKNTQHREVYADYFKTACEGYKNIALIDVGWMGNIQ
CEECCCCCCCHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHCCCCCEEEEEECCCCCHH
SVFARSLGAQWAEKQIHGFYLATFAGANDNRSIYNKMFGWLTNYGHPNDKCDLFLSGGVE
HHHHHHHHHHHHHHHHCEEEEEEEECCCCCHHHHHHHHHHHHCCCCCCCCEEEEECCCHH
IMEFAMADNTGSTIGYKKTDNGIIPVREDSSGSEIEYLKKAARLQSGIISFFEYVKPLIQ
HHHHHHCCCCCCCCCEEECCCCEEEEECCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHH
KGNYAALSSVVLSEPFFELIARPSSAQLDALSSLTHSESAGSNAERIVLAKKLPLKDKLF
CCCHHHHHHHHHHCHHHHHHCCCCCCHHHHHHHHHHCCCCCCCCCEEEEEECCCCCCCCC
PGENYIKELNASYWKEGFKRINRKKFWAKYN
CCHHHHHHHHHHHHHHHHHHHHHHHHCCCCC
>Mature Secondary Structure
MVSRRIYRPRDLFSLMQSTLATEKFFISAYEIGIIDNFPEIRVQAEVSARENRVRRFGGE
CCCCCCCCHHHHHHHHHHHHHHHHHEEEEEEEEEECCCCCEEEEEEHHHHHHHHHHCCCC
PEILISEIYDEILKKHPQLSPATVKKIIDLEIQMEKIVLYKNARGSCLFEKAISDGCKVI
CHHHHHHHHHHHHHHCCCCCHHHHHHHHHHEEEEEEEEEEECCCCCCHHHHHHCCCCEEE
LISDMYLPSAILKELLTSCGYDISNIPVYSSGEERYSKNSGKLFSIVKKNENVDIASWMH
EEECCCCCHHHHHHHHHHCCCCCCCCCEECCCHHHHCCCCCCEEEEEECCCCCCHHHHHH
VGDNVHADILNAKKLGINTLHADWSEYNHGISNHWKAKDIIGESICKTLLLKQVSAFHQN
CCCCCCHHHHHHHHCCCCCEECCHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHCC
DPLNEIGFKVFGPLLLGYVSWLANQLKIHKIDKALFLARDAHLIYKIYNEYFSEEHVKCE
CCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCEEE
YLYISRASAYMVGMTDWPMHRIWHLFGGKNKKSIKKILAIAGLDASEHISDIHHVGFPDE
EEEEECCCEEEEECCCCHHHHHHHHHCCCCHHHHHHHHHHHCCCHHHHHHHHHHCCCCCC
EYIPVSGEEHKVHWLINKLFPYILLKNTQHREVYADYFKTACEGYKNIALIDVGWMGNIQ
CEECCCCCCCHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHCCCCCEEEEEECCCCCHH
SVFARSLGAQWAEKQIHGFYLATFAGANDNRSIYNKMFGWLTNYGHPNDKCDLFLSGGVE
HHHHHHHHHHHHHHHHCEEEEEEEECCCCCHHHHHHHHHHHHCCCCCCCCEEEEECCCHH
IMEFAMADNTGSTIGYKKTDNGIIPVREDSSGSEIEYLKKAARLQSGIISFFEYVKPLIQ
HHHHHHCCCCCCCCCEEECCCCEEEEECCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHH
KGNYAALSSVVLSEPFFELIARPSSAQLDALSSLTHSESAGSNAERIVLAKKLPLKDKLF
CCCHHHHHHHHHHCHHHHHHCCCCCCHHHHHHHHHHCCCCCCCCCEEEEEECCCCCCCCC
PGENYIKELNASYWKEGFKRINRKKFWAKYN
CCHHHHHHHHHHHHHHHHHHHHHHHHCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA