| Definition | Salmonella enterica subsp. enterica serovar Typhi str. Ty2 chromosome, complete genome. |
|---|---|
| Accession | NC_004631 |
| Length | 4,791,961 |
Click here to switch to the map view.
The map label for this gene is treF [H]
Identifier: 29144186
GI number: 29144186
Start: 4050841
End: 4052490
Strand: Reverse
Name: treF [H]
Synonym: t3914
Alternate gene names: 29144186
Gene position: 4052490-4050841 (Counterclockwise)
Preceding gene: 29144189
Following gene: 29144184
Centisome position: 84.57
GC content: 55.09
Gene sequence:
>1650_bases ATGCTCAACCAGAAATTAAACCCCACGCCTTCTGAAGATCTGACTATTGATGTCGATCTGTTTTATGAAACAGACCCGTG CGAGTTAAAGCTGGATGAAATGATCGAGGCGGAACCGGAGCCGGAGATGATCGAGGGGCTTCCCGCCTCTGACGCCCTGA CCCCTGCCGATCGGTATCTCGAACTGTTCGAGCATGTACAGTCAACAAAACTGTTTCCAGACAGTAAAACGTTCCCGGAC TGCGCGCCGAAGATGGACCCGCTTGATATCCTGATCCGCTACCGTAAGGTCAGACGCCACCGTGATTTTGACTTACGCCG CTTCGTCGAGAACCATTTCTGGCTACCGGAAACCTTATCCAGCGAGTATGTCTCTAACCCCGAAAACTCGCTCAAAGAAC ATATTGACCAGCTTTGGCCGATACTGACGCGCGAACCGCAGGATCATATTCCGTGGTCTTCGCTGCTGGCGCTGCCGCAA TCCTATATCGTGCCGGGAGGCCGTTTTAGCGAAACCTATTATTGGGACTCTTATTTTACCATGCTGGGTCTGGCGGAAAG CGGGCGCGAAGACTTACTTAAATGTATGGCGGATAATTTCGCCTGGATGATTGAAAACTATGGTCATATTCCCAACGGCA ACCGCACCTATTATCTGAGCCGCTCGCAGCCGCCGGTTTTCGCCCTGATGGTTGAACTGTTCGAAGAAGATGGCGTGCGC GGCGCGCGGCGTTATCTCGACCATCTCAAAATGGAATACGCCTTCTGGATGGACGGCGCCGAATCGCTGGCGCTCAACCA GGCTTATCGCCACGTTGTGCGGATGCCGGACGGTTCCCTGCTGAACCGCTACTGGGACGATCGCGACACGCCGCGCGACG AGTCCTGGCTGGAAGATGTCGAAACCGCAAAACATTCCGGTCGTCCGCCCAATGAAGTCTACCGGGATTTGCGCGCCGGG GCGGCGTCCGGCTGGGACTATTCTTCACGCTGGCTACGCGATGCGGGCCGGCTTGCCAGCATACGTACAACTCAGTTTAT CCCTATCGATTTGAACGCTTTTCTGTATAAACTGGAGAGCGCTATCGCCAATATTTCAGCGCTGAAAGGCGAACGTGACA CCGAGGCGCTATTTCGCCAGAAAGCCAGCGATCGACGCGCCGCCGTGAACCATTATTTGTGGGATGATGAAAACGGCTGT TATCGGGACTATGACTGGCGACGCGAAGAAATGGCGCTCTTTTCCGCCGCCAGTATCGTGCCGCTGTATGTCGGTATGGC GAACCATGAGCAGGCCGACCGTCTGGCAAATGTAGTACGCAGCCGTCTGTTAACGCCCGGCGGGATTATGGCGACCGAAT ACGAAACCGGCGAACAGTGGGATAAACCGAACGGCTGGGCGCCGCTGCAATGGATGGCGATTCAGGGCTTCAAACGGTAT GGCGACGATATGCTGGGCGATGAAATCGCCCATAACTGGTTAAAAACGGTGAACCATTTTTATCAGGAGCACCATAAACT GATCGAGAAATACCATATTTCCGGCGGTACGCCCCGCGAAGGCGGCGGGGGCGAGTATCCGCTACAGGATGGGTTCGGCT GGACCAATGGCGTGGTGCGCCGCCTGATTGGCCTTTACGGAGAGCCTTAA
Upstream 100 bases:
>100_bases CACACTTTGCCACTCAGGTATCGAAGCGAATGTCTACGCTTAATAGACAGCCGGGCAACACCCGTATCTTTTACGACGCA AGCCGGAGGTCCTTGTCATT
Downstream 100 bases:
>100_bases CCTGCTCCGGGCTCAGTGAATCGCATCATAAATGGCTGACTGAATTTTCAGCCATTTTTTATTGTCTGCGCTGGGCCGGG CCTGAGCGCGCAGCTGGGCC
Product: trehalase
Products: NA
Alternate protein names: Alpha,alpha-trehalase; Alpha,alpha-trehalose glucohydrolase [H]
Number of amino acids: Translated: 549; Mature: 549
Protein sequence:
>549_residues MLNQKLNPTPSEDLTIDVDLFYETDPCELKLDEMIEAEPEPEMIEGLPASDALTPADRYLELFEHVQSTKLFPDSKTFPD CAPKMDPLDILIRYRKVRRHRDFDLRRFVENHFWLPETLSSEYVSNPENSLKEHIDQLWPILTREPQDHIPWSSLLALPQ SYIVPGGRFSETYYWDSYFTMLGLAESGREDLLKCMADNFAWMIENYGHIPNGNRTYYLSRSQPPVFALMVELFEEDGVR GARRYLDHLKMEYAFWMDGAESLALNQAYRHVVRMPDGSLLNRYWDDRDTPRDESWLEDVETAKHSGRPPNEVYRDLRAG AASGWDYSSRWLRDAGRLASIRTTQFIPIDLNAFLYKLESAIANISALKGERDTEALFRQKASDRRAAVNHYLWDDENGC YRDYDWRREEMALFSAASIVPLYVGMANHEQADRLANVVRSRLLTPGGIMATEYETGEQWDKPNGWAPLQWMAIQGFKRY GDDMLGDEIAHNWLKTVNHFYQEHHKLIEKYHISGGTPREGGGGEYPLQDGFGWTNGVVRRLIGLYGEP
Sequences:
>Translated_549_residues MLNQKLNPTPSEDLTIDVDLFYETDPCELKLDEMIEAEPEPEMIEGLPASDALTPADRYLELFEHVQSTKLFPDSKTFPD CAPKMDPLDILIRYRKVRRHRDFDLRRFVENHFWLPETLSSEYVSNPENSLKEHIDQLWPILTREPQDHIPWSSLLALPQ SYIVPGGRFSETYYWDSYFTMLGLAESGREDLLKCMADNFAWMIENYGHIPNGNRTYYLSRSQPPVFALMVELFEEDGVR GARRYLDHLKMEYAFWMDGAESLALNQAYRHVVRMPDGSLLNRYWDDRDTPRDESWLEDVETAKHSGRPPNEVYRDLRAG AASGWDYSSRWLRDAGRLASIRTTQFIPIDLNAFLYKLESAIANISALKGERDTEALFRQKASDRRAAVNHYLWDDENGC YRDYDWRREEMALFSAASIVPLYVGMANHEQADRLANVVRSRLLTPGGIMATEYETGEQWDKPNGWAPLQWMAIQGFKRY GDDMLGDEIAHNWLKTVNHFYQEHHKLIEKYHISGGTPREGGGGEYPLQDGFGWTNGVVRRLIGLYGEP >Mature_549_residues MLNQKLNPTPSEDLTIDVDLFYETDPCELKLDEMIEAEPEPEMIEGLPASDALTPADRYLELFEHVQSTKLFPDSKTFPD CAPKMDPLDILIRYRKVRRHRDFDLRRFVENHFWLPETLSSEYVSNPENSLKEHIDQLWPILTREPQDHIPWSSLLALPQ SYIVPGGRFSETYYWDSYFTMLGLAESGREDLLKCMADNFAWMIENYGHIPNGNRTYYLSRSQPPVFALMVELFEEDGVR GARRYLDHLKMEYAFWMDGAESLALNQAYRHVVRMPDGSLLNRYWDDRDTPRDESWLEDVETAKHSGRPPNEVYRDLRAG AASGWDYSSRWLRDAGRLASIRTTQFIPIDLNAFLYKLESAIANISALKGERDTEALFRQKASDRRAAVNHYLWDDENGC YRDYDWRREEMALFSAASIVPLYVGMANHEQADRLANVVRSRLLTPGGIMATEYETGEQWDKPNGWAPLQWMAIQGFKRY GDDMLGDEIAHNWLKTVNHFYQEHHKLIEKYHISGGTPREGGGGEYPLQDGFGWTNGVVRRLIGLYGEP
Specific function: Hydrolyzes trehalose to glucose. Could be involved, in cells returning to low osmolarity conditions, in the utilization of the accumulated cytoplasmic trehalose, which was synthesized in response to high osmolarity [H]
COG id: COG1626
COG function: function code G; Neutral trehalase
Gene ontology:
Cell location: Cytoplasm [H]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the glycosyl hydrolase 37 family [H]
Homologues:
Organism=Homo sapiens, GI116284412, Length=529, Percent_Identity=35.7277882797732, Blast_Score=260, Evalue=3e-69, Organism=Escherichia coli, GI1789936, Length=550, Percent_Identity=92, Blast_Score=1046, Evalue=0.0, Organism=Escherichia coli, GI1787447, Length=487, Percent_Identity=50.7186858316222, Blast_Score=502, Evalue=1e-143, Organism=Caenorhabditis elegans, GI17542196, Length=527, Percent_Identity=31.8785578747628, Blast_Score=251, Evalue=7e-67, Organism=Caenorhabditis elegans, GI17565078, Length=510, Percent_Identity=31.9607843137255, Blast_Score=239, Evalue=4e-63, Organism=Caenorhabditis elegans, GI25141398, Length=530, Percent_Identity=31.5094339622642, Blast_Score=231, Evalue=8e-61, Organism=Caenorhabditis elegans, GI25148109, Length=549, Percent_Identity=30.2367941712204, Blast_Score=231, Evalue=9e-61, Organism=Caenorhabditis elegans, GI71987755, Length=416, Percent_Identity=31.25, Blast_Score=192, Evalue=5e-49, Organism=Saccharomyces cerevisiae, GI6320204, Length=473, Percent_Identity=28.5412262156448, Blast_Score=159, Evalue=1e-39, Organism=Saccharomyces cerevisiae, GI6319473, Length=485, Percent_Identity=29.2783505154639, Blast_Score=149, Evalue=1e-36, Organism=Drosophila melanogaster, GI24656680, Length=548, Percent_Identity=31.5693430656934, Blast_Score=228, Evalue=9e-60, Organism=Drosophila melanogaster, GI24656675, Length=548, Percent_Identity=31.5693430656934, Blast_Score=228, Evalue=9e-60, Organism=Drosophila melanogaster, GI24656661, Length=533, Percent_Identity=31.7073170731707, Blast_Score=226, Evalue=3e-59, Organism=Drosophila melanogaster, GI17933716, Length=533, Percent_Identity=31.7073170731707, Blast_Score=226, Evalue=3e-59, Organism=Drosophila melanogaster, GI24656670, Length=533, Percent_Identity=31.7073170731707, Blast_Score=226, Evalue=3e-59, Organism=Drosophila melanogaster, GI24656685, Length=484, Percent_Identity=32.2314049586777, Blast_Score=216, Evalue=4e-56, Organism=Drosophila melanogaster, GI22024178, Length=538, Percent_Identity=26.2081784386617, Blast_Score=180, Evalue=2e-45, Organism=Drosophila melanogaster, GI45551104, Length=380, Percent_Identity=26.0526315789474, Blast_Score=130, Evalue=3e-30, Organism=Drosophila melanogaster, GI28573474, Length=295, Percent_Identity=26.7796610169492, Blast_Score=103, Evalue=3e-22,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR008928 - InterPro: IPR001661 - InterPro: IPR018232 [H]
Pfam domain/function: PF01204 Trehalase [H]
EC number: =3.2.1.28 [H]
Molecular weight: Translated: 63679; Mature: 63679
Theoretical pI: Translated: 4.77; Mature: 4.77
Prosite motif: PS00927 TREHALASE_1 ; PS00928 TREHALASE_2
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.7 %Cys (Translated Protein) 2.9 %Met (Translated Protein) 3.6 %Cys+Met (Translated Protein) 0.7 %Cys (Mature Protein) 2.9 %Met (Mature Protein) 3.6 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MLNQKLNPTPSEDLTIDVDLFYETDPCELKLDEMIEAEPEPEMIEGLPASDALTPADRYL CCCCCCCCCCCCCEEEEEEEEECCCCCCEEHHHHHCCCCCHHHHCCCCCCCCCCHHHHHH ELFEHVQSTKLFPDSKTFPDCAPKMDPLDILIRYRKVRRHRDFDLRRFVENHFWLPETLS HHHHHHHHHCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHCCCHHHHHHHHHCCCCCHHHH SEYVSNPENSLKEHIDQLWPILTREPQDHIPWSSLLALPQSYIVPGGRFSETYYWDSYFT HHHHCCCHHHHHHHHHHHHHHHCCCCCCCCCHHHHHHCCHHHCCCCCCCCCCEEEHHHHH MLGLAESGREDLLKCMADNFAWMIENYGHIPNGNRTYYLSRSQPPVFALMVELFEEDGVR HHHHHHCCHHHHHHHHHHHHHHHHHCCCCCCCCCEEEEECCCCCCHHHHHHHHHHHCCCH GARRYLDHLKMEYAFWMDGAESLALNQAYRHVVRMPDGSLLNRYWDDRDTPRDESWLEDV HHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHCCCCCHHHHHHCCCCCCCCCHHHHHHH ETAKHSGRPPNEVYRDLRAGAASGWDYSSRWLRDAGRLASIRTTQFIPIDLNAFLYKLES HHHHHCCCCHHHHHHHHHHCCCCCCCHHHHHHHHHHHHEEECCCEEEEECHHHHHHHHHH AIANISALKGERDTEALFRQKASDRRAAVNHYLWDDENGCYRDYDWRREEMALFSAASIV HHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHCEECCCCCCCCCCCCCHHHHHHHHHHHHH PLYVGMANHEQADRLANVVRSRLLTPGGIMATEYETGEQWDKPNGWAPLQWMAIQGFKRY HHHHCCCCHHHHHHHHHHHHHHHCCCCCCEEEECCCCCCCCCCCCCCCHHHHHHHHHHHH GDDMLGDEIAHNWLKTVNHFYQEHHKLIEKYHISGGTPREGGGGEYPLQDGFGWTNGVVR CCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCHHHHHHH RLIGLYGEP HHHHHCCCC >Mature Secondary Structure MLNQKLNPTPSEDLTIDVDLFYETDPCELKLDEMIEAEPEPEMIEGLPASDALTPADRYL CCCCCCCCCCCCCEEEEEEEEECCCCCCEEHHHHHCCCCCHHHHCCCCCCCCCCHHHHHH ELFEHVQSTKLFPDSKTFPDCAPKMDPLDILIRYRKVRRHRDFDLRRFVENHFWLPETLS HHHHHHHHHCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHCCCHHHHHHHHHCCCCCHHHH SEYVSNPENSLKEHIDQLWPILTREPQDHIPWSSLLALPQSYIVPGGRFSETYYWDSYFT HHHHCCCHHHHHHHHHHHHHHHCCCCCCCCCHHHHHHCCHHHCCCCCCCCCCEEEHHHHH MLGLAESGREDLLKCMADNFAWMIENYGHIPNGNRTYYLSRSQPPVFALMVELFEEDGVR HHHHHHCCHHHHHHHHHHHHHHHHHCCCCCCCCCEEEEECCCCCCHHHHHHHHHHHCCCH GARRYLDHLKMEYAFWMDGAESLALNQAYRHVVRMPDGSLLNRYWDDRDTPRDESWLEDV HHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHCCCCCHHHHHHCCCCCCCCCHHHHHHH ETAKHSGRPPNEVYRDLRAGAASGWDYSSRWLRDAGRLASIRTTQFIPIDLNAFLYKLES HHHHHCCCCHHHHHHHHHHCCCCCCCHHHHHHHHHHHHEEECCCEEEEECHHHHHHHHHH AIANISALKGERDTEALFRQKASDRRAAVNHYLWDDENGCYRDYDWRREEMALFSAASIV HHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHCEECCCCCCCCCCCCCHHHHHHHHHHHHH PLYVGMANHEQADRLANVVRSRLLTPGGIMATEYETGEQWDKPNGWAPLQWMAIQGFKRY HHHHCCCCHHHHHHHHHHHHHHHCCCCCCEEEECCCCCCCCCCCCCCCHHHHHHHHHHHH GDDMLGDEIAHNWLKTVNHFYQEHHKLIEKYHISGGTPREGGGGEYPLQDGFGWTNGVVR CCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCHHHHHHH RLIGLYGEP HHHHHCCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: NA