| Definition | Shigella flexneri 2a str. 2457T, complete genome. |
|---|---|
| Accession | NC_004741 |
| Length | 4,599,354 |
Click here to switch to the map view.
The map label for this gene is treA
Identifier: 30062721
GI number: 30062721
Start: 1242200
End: 1243897
Strand: Reverse
Name: treA
Synonym: S1284
Alternate gene names: 30062721
Gene position: 1243897-1242200 (Counterclockwise)
Preceding gene: 30062722
Following gene: 30062720
Centisome position: 27.05
GC content: 51.71
Gene sequence:
>1698_bases ATGAAATCCCCCGCACCTTCTCGCCCGCAAAAAATGGCGTTAATTCCAGCCTGTATCTTTTTGTGTTTCGCTGCGCTATC GGTGCAGGCAGAAGAAACACCGGTAACACCACAGCCGCCTGATATTTTATTAGGGCCGCTGTTTAATGATGTGCAAAACG TCAAACTTTTTCCGGACCAAAAAACCTTTGCCGATGCCGTGCCTAACAGCGATCCGCTGATGATCCTTGCTGATTATCGG ATGCAGCAAAACCAGAGCGGATTTGATCTGCGCCATTTCGTTAACGTCAATTTCACCCTGCCGAAAGAAGGCGAGAAATA TGTTCCGCCAGAGGGGCAGTCACTGCGCGAACATATTGACGGACTTTGGCCGGTATTAACGCGTTCTACCGAAAACACCG AAAAATGGGATTCTCTGTTACCGCTGCCGGAACCTTATGTCGTGCCGGGCGGACGTTTTCGCGAGGTATATTACTGGGAC AATTACTTCACCATGTTAGGACTTGCCGAAAGTGGTCACTGGGATAAAATCGCGGATATGGTGGCCAATTTTGCTCATGA AATAAACACTTACGGTCATATTCCCAACGGCAACCGCAGTTACTATTTAAGCCGCTCGCAACCGCCCTTCTTTGCCCTGA TGGTAGAGTTACTGGCGCAGCATGAAGGCGATGCCGCGTTGAAGCAATACCTGCCGCAAATGCAAAAAGAATATGCTTAC TGGATGGACGGTGTTGAAAACCTGCAAGCCGGACAACAGGAAAAACGCGTTGTAAAACTTCAGGATAGTACCCTTCTCAA CCGCTACTGGGACGATCGCGATACGCCACGACCAGAGTCATGGGTGGAAGATATTGCCACCGCCAAAAGCAATCCGAATC GACCTGCCACTGAAATTTACCGCGACCTGCGCTCTGCCGCTGCGTCTGGCTGGGATTTCAGCTCGCGCTGGATGGACAAC CCGCAGCAGTTAAATACCTTACGCACCACCAGCATCGTACCGGTCGATCTGAACAGCCTGATGTTTAAAATGGAAAAAAT CCTCGCCCGCGCCAGCAAAGCTGCAGGAGATAACGCGATGGCAAACCAGTACGAAACGCTGGCGAATGCCCGTCAAAAAG GGATCGAAAAATACCTGTGGAACGATCAACAAGGCTGGTATGCCGATTACGACCTGAAAAGTCATAAAGTGCGCAATCAG TTAACCGCGGCCGCCCTGTTCCCGCTGTACGTCAATGCGGCAGCGAAAGATCGCGCCAACAAAATGGCGACGGCGACGAA AACACATCTGCTGCAACCCGGCGGCCTGAACACCACGTCGGTGAAAAGTGGGCAACAATGGGATGCGCCAAATGGCTGGG CACCGTTACAGTGGGTCGCGACAGAAGGATTACAAAACTACGGGCAAAAAGAGGTGGCGATGGACATTAGCTGGCACTTC CTGACCAATGTTCAGCACACCTATGACCGGGAGAAAAAGCTGGTGGAAAAATATGATGTCAGCACCACCGGAACGGGGGG CGGCGGTGGCGAATATCCATTACAGGATGGCTTTGGCTGGACCAATGGCGTGACGCTGAAAATGCTGGATTTGATCTGCC CGAAAGAGCAACCGTGTGACAATGTTCCGGCGACGCATCCGACCGTTAAGTCAGCAACGACGCAACCCTCAACCAAAGAG GCACAACCCACACCTTAA
Upstream 100 bases:
>100_bases GCAGAATGAGATTTCGATCATGCAGCTAGTGCGATCCTGAACTAAGGTTTTCTGATACTTGAATACCGTTTTATTCGGTT TCGCCAAAGGAGAATGATTG
Downstream 100 bases:
>100_bases CCAGCGCTTACTCCGACAACGTCATTCGGCTTCTCCGGATGGCGTTGTCGGCAGATAACACCATATCTATGGTTTTTTCT ACACAGACGGTTTTTCAAGT
Product: trehalase
Products: NA
Alternate protein names: Alpha,alpha-trehalase; Alpha,alpha-trehalose glucohydrolase [H]
Number of amino acids: Translated: 565; Mature: 565
Protein sequence:
>565_residues MKSPAPSRPQKMALIPACIFLCFAALSVQAEETPVTPQPPDILLGPLFNDVQNVKLFPDQKTFADAVPNSDPLMILADYR MQQNQSGFDLRHFVNVNFTLPKEGEKYVPPEGQSLREHIDGLWPVLTRSTENTEKWDSLLPLPEPYVVPGGRFREVYYWD NYFTMLGLAESGHWDKIADMVANFAHEINTYGHIPNGNRSYYLSRSQPPFFALMVELLAQHEGDAALKQYLPQMQKEYAY WMDGVENLQAGQQEKRVVKLQDSTLLNRYWDDRDTPRPESWVEDIATAKSNPNRPATEIYRDLRSAAASGWDFSSRWMDN PQQLNTLRTTSIVPVDLNSLMFKMEKILARASKAAGDNAMANQYETLANARQKGIEKYLWNDQQGWYADYDLKSHKVRNQ LTAAALFPLYVNAAAKDRANKMATATKTHLLQPGGLNTTSVKSGQQWDAPNGWAPLQWVATEGLQNYGQKEVAMDISWHF LTNVQHTYDREKKLVEKYDVSTTGTGGGGGEYPLQDGFGWTNGVTLKMLDLICPKEQPCDNVPATHPTVKSATTQPSTKE AQPTP
Sequences:
>Translated_565_residues MKSPAPSRPQKMALIPACIFLCFAALSVQAEETPVTPQPPDILLGPLFNDVQNVKLFPDQKTFADAVPNSDPLMILADYR MQQNQSGFDLRHFVNVNFTLPKEGEKYVPPEGQSLREHIDGLWPVLTRSTENTEKWDSLLPLPEPYVVPGGRFREVYYWD NYFTMLGLAESGHWDKIADMVANFAHEINTYGHIPNGNRSYYLSRSQPPFFALMVELLAQHEGDAALKQYLPQMQKEYAY WMDGVENLQAGQQEKRVVKLQDSTLLNRYWDDRDTPRPESWVEDIATAKSNPNRPATEIYRDLRSAAASGWDFSSRWMDN PQQLNTLRTTSIVPVDLNSLMFKMEKILARASKAAGDNAMANQYETLANARQKGIEKYLWNDQQGWYADYDLKSHKVRNQ LTAAALFPLYVNAAAKDRANKMATATKTHLLQPGGLNTTSVKSGQQWDAPNGWAPLQWVATEGLQNYGQKEVAMDISWHF LTNVQHTYDREKKLVEKYDVSTTGTGGGGGEYPLQDGFGWTNGVTLKMLDLICPKEQPCDNVPATHPTVKSATTQPSTKE AQPTP >Mature_565_residues MKSPAPSRPQKMALIPACIFLCFAALSVQAEETPVTPQPPDILLGPLFNDVQNVKLFPDQKTFADAVPNSDPLMILADYR MQQNQSGFDLRHFVNVNFTLPKEGEKYVPPEGQSLREHIDGLWPVLTRSTENTEKWDSLLPLPEPYVVPGGRFREVYYWD NYFTMLGLAESGHWDKIADMVANFAHEINTYGHIPNGNRSYYLSRSQPPFFALMVELLAQHEGDAALKQYLPQMQKEYAY WMDGVENLQAGQQEKRVVKLQDSTLLNRYWDDRDTPRPESWVEDIATAKSNPNRPATEIYRDLRSAAASGWDFSSRWMDN PQQLNTLRTTSIVPVDLNSLMFKMEKILARASKAAGDNAMANQYETLANARQKGIEKYLWNDQQGWYADYDLKSHKVRNQ LTAAALFPLYVNAAAKDRANKMATATKTHLLQPGGLNTTSVKSGQQWDAPNGWAPLQWVATEGLQNYGQKEVAMDISWHF LTNVQHTYDREKKLVEKYDVSTTGTGGGGGEYPLQDGFGWTNGVTLKMLDLICPKEQPCDNVPATHPTVKSATTQPSTKE AQPTP
Specific function: Provides the cells with the ability to utilize trehalose at high osmolarity by splitting it into glucose molecules that can subsequently be taken up by the phosphotransferase-mediated uptake system [H]
COG id: COG1626
COG function: function code G; Neutral trehalase
Gene ontology:
Cell location: Periplasm [H]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the glycosyl hydrolase 37 family [H]
Homologues:
Organism=Homo sapiens, GI116284412, Length=526, Percent_Identity=33.2699619771863, Blast_Score=262, Evalue=6e-70, Organism=Escherichia coli, GI1787447, Length=565, Percent_Identity=98.9380530973451, Blast_Score=1169, Evalue=0.0, Organism=Escherichia coli, GI1789936, Length=487, Percent_Identity=50.5133470225873, Blast_Score=507, Evalue=1e-145, Organism=Caenorhabditis elegans, GI17542196, Length=520, Percent_Identity=33.6538461538462, Blast_Score=267, Evalue=1e-71, Organism=Caenorhabditis elegans, GI25148109, Length=574, Percent_Identity=31.8815331010453, Blast_Score=248, Evalue=5e-66, Organism=Caenorhabditis elegans, GI25141398, Length=527, Percent_Identity=31.4990512333966, Blast_Score=239, Evalue=4e-63, Organism=Caenorhabditis elegans, GI17565078, Length=545, Percent_Identity=31.5596330275229, Blast_Score=232, Evalue=3e-61, Organism=Caenorhabditis elegans, GI71987755, Length=403, Percent_Identity=28.5359801488834, Blast_Score=182, Evalue=3e-46, Organism=Saccharomyces cerevisiae, GI6320204, Length=436, Percent_Identity=30.045871559633, Blast_Score=160, Evalue=5e-40, Organism=Saccharomyces cerevisiae, GI6319473, Length=428, Percent_Identity=29.9065420560748, Blast_Score=150, Evalue=5e-37, Organism=Drosophila melanogaster, GI24656680, Length=528, Percent_Identity=34.0909090909091, Blast_Score=271, Evalue=6e-73, Organism=Drosophila melanogaster, GI24656675, Length=528, Percent_Identity=34.0909090909091, Blast_Score=271, Evalue=6e-73, Organism=Drosophila melanogaster, GI24656661, Length=528, Percent_Identity=34.0909090909091, Blast_Score=270, Evalue=1e-72, Organism=Drosophila melanogaster, GI17933716, Length=528, Percent_Identity=34.0909090909091, Blast_Score=270, Evalue=1e-72, Organism=Drosophila melanogaster, GI24656670, Length=528, Percent_Identity=34.0909090909091, Blast_Score=270, Evalue=1e-72, Organism=Drosophila melanogaster, GI24656685, Length=502, Percent_Identity=33.6653386454183, Blast_Score=255, Evalue=6e-68, Organism=Drosophila melanogaster, GI22024178, Length=527, Percent_Identity=30.9297912713473, Blast_Score=234, Evalue=9e-62, Organism=Drosophila melanogaster, GI45551104, Length=367, Percent_Identity=32.425068119891, Blast_Score=172, Evalue=4e-43, Organism=Drosophila melanogaster, GI28573474, Length=314, Percent_Identity=28.0254777070064, Blast_Score=119, Evalue=7e-27,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR008928 - InterPro: IPR001661 - InterPro: IPR018232 [H]
Pfam domain/function: PF01204 Trehalase [H]
EC number: =3.2.1.28 [H]
Molecular weight: Translated: 63716; Mature: 63716
Theoretical pI: Translated: 5.83; Mature: 5.83
Prosite motif: PS00927 TREHALASE_1 ; PS00928 TREHALASE_2
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.7 %Cys (Translated Protein) 2.8 %Met (Translated Protein) 3.5 %Cys+Met (Translated Protein) 0.7 %Cys (Mature Protein) 2.8 %Met (Mature Protein) 3.5 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MKSPAPSRPQKMALIPACIFLCFAALSVQAEETPVTPQPPDILLGPLFNDVQNVKLFPDQ CCCCCCCCCHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCEEECHHHHCCCCCEECCCC KTFADAVPNSDPLMILADYRMQQNQSGFDLRHFVNVNFTLPKEGEKYVPPEGQSLREHID HHHHHCCCCCCCEEEEECCHHHCCCCCCCEEEEEEEEEECCCCCCCCCCCCCHHHHHHHH GLWPVLTRSTENTEKWDSLLPLPEPYVVPGGRFREVYYWDNYFTMLGLAESGHWDKIADM HHHHHHHCCCCCHHHHHHCCCCCCCEECCCCCEEEEEEECCEEEEEEECCCCCHHHHHHH VANFAHEINTYGHIPNGNRSYYLSRSQPPFFALMVELLAQHEGDAALKQYLPQMQKEYAY HHHHHHHHHCCCCCCCCCCEEEECCCCCHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHH WMDGVENLQAGQQEKRVVKLQDSTLLNRYWDDRDTPRPESWVEDIATAKSNPNRPATEIY HHHHHHHHHCCCHHHHEEEECCHHHHHHHCCCCCCCCHHHHHHHHHHHCCCCCCCHHHHH RDLRSAAASGWDFSSRWMDNPQQLNTLRTTSIVPVDLNSLMFKMEKILARASKAAGDNAM HHHHHHHCCCCCCHHHHCCCHHHHHHHHHCEEEEECHHHHHHHHHHHHHHHHHHCCCCHH ANQYETLANARQKGIEKYLWNDQQGWYADYDLKSHKVRNQLTAAALFPLYVNAAAKDRAN HHHHHHHHHHHHHHHHHHHCCCCCCCEECCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHH KMATATKTHLLQPGGLNTTSVKSGQQWDAPNGWAPLQWVATEGLQNYGQKEVAMDISWHF HHHHHHHHHEECCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHCCCCEEEEEEEHHH LTNVQHTYDREKKLVEKYDVSTTGTGGGGGEYPLQDGFGWTNGVTLKMLDLICPKEQPCD HHCCHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHCCCCCCCC NVPATHPTVKSATTQPSTKEAQPTP CCCCCCCCCCCCCCCCCCCCCCCCC >Mature Secondary Structure MKSPAPSRPQKMALIPACIFLCFAALSVQAEETPVTPQPPDILLGPLFNDVQNVKLFPDQ CCCCCCCCCHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCEEECHHHHCCCCCEECCCC KTFADAVPNSDPLMILADYRMQQNQSGFDLRHFVNVNFTLPKEGEKYVPPEGQSLREHID HHHHHCCCCCCCEEEEECCHHHCCCCCCCEEEEEEEEEECCCCCCCCCCCCCHHHHHHHH GLWPVLTRSTENTEKWDSLLPLPEPYVVPGGRFREVYYWDNYFTMLGLAESGHWDKIADM HHHHHHHCCCCCHHHHHHCCCCCCCEECCCCCEEEEEEECCEEEEEEECCCCCHHHHHHH VANFAHEINTYGHIPNGNRSYYLSRSQPPFFALMVELLAQHEGDAALKQYLPQMQKEYAY HHHHHHHHHCCCCCCCCCCEEEECCCCCHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHH WMDGVENLQAGQQEKRVVKLQDSTLLNRYWDDRDTPRPESWVEDIATAKSNPNRPATEIY HHHHHHHHHCCCHHHHEEEECCHHHHHHHCCCCCCCCHHHHHHHHHHHCCCCCCCHHHHH RDLRSAAASGWDFSSRWMDNPQQLNTLRTTSIVPVDLNSLMFKMEKILARASKAAGDNAM HHHHHHHCCCCCCHHHHCCCHHHHHHHHHCEEEEECHHHHHHHHHHHHHHHHHHCCCCHH ANQYETLANARQKGIEKYLWNDQQGWYADYDLKSHKVRNQLTAAALFPLYVNAAAKDRAN HHHHHHHHHHHHHHHHHHHCCCCCCCEECCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHH KMATATKTHLLQPGGLNTTSVKSGQQWDAPNGWAPLQWVATEGLQNYGQKEVAMDISWHF HHHHHHHHHEECCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHCCCCEEEEEEEHHH LTNVQHTYDREKKLVEKYDVSTTGTGGGGGEYPLQDGFGWTNGVTLKMLDLICPKEQPCD HHCCHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHCCCCCCCC NVPATHPTVKSATTQPSTKEAQPTP CCCCCCCCCCCCCCCCCCCCCCCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: NA