Definition Mycobacterium bovis BCG str. Pasteur 1173P2, complete genome.
Accession NC_008769
Length 4,374,522

Click here to switch to the map view.

The map label for this gene is treY

Identifier: 121637485

GI number: 121637485

Start: 1781629

End: 1783926

Strand: Reverse

Name: treY

Synonym: BCG_1616c

Alternate gene names: 121637485

Gene position: 1783926-1781629 (Counterclockwise)

Preceding gene: 121637486

Following gene: 121637484

Centisome position: 40.78

GC content: 66.67

Gene sequence:

>2298_bases
ATGGCATTTCCGGTTATTTCCACTTACCGGGTGCAGATGCGCGGTCGGTCGAACGGATTCGGGTTCACCTTCGCCGATGC
CGAGAACCTGCTGGACTACCTCGACGACCTCGGGGTATCGCATCTGTACCTGTCCCCCATTTTGACGGCGGTCGGCGGGT
CGACCCACGGCTATGACGTCACCGATCCGACGACGGTGTCACCCGAGCTTGGTGGCTCTGACGGCCTAGCGCGGTTATCC
GCGGCGGCGCGGTCGCGGGGCATGGGCCTGATCGTCGACATCGTGCCCAGCCATGTCGGCGTCGGCAAGCCCGAGCAGAA
CGCGTGGTGGTGGGATGTCTTGAAGTTCGGCCGGTCCTCGGCGTATGCCGAGTTCTTCGACATCGACTGGGAGCTAGGTG
ATGGCCGGATCATCCTGCCGCTATTGGGCTCCGACAGCGACGTTGCCAACCTCAGAGTCGACGGCGACCTGCTGCGGCTG
GGCGACCTGGCGCTGCCCGTCGCCCCCGGCAGCGGGGACGGCACCGGCCCCGCTGTGCACGACCGCCAGCACTATCGGCT
GGTCGGATGGCGGCACGGGCTGTGCGGCTACCGCCGTTTCTTCTCGATCACCTCGTTGGCCGGCCTGCGCCAGGAAGACC
GCGCTGTGTTCGACGCCAGCCACGCAGAGGTCGCTCGCTGGTTCACCGAAGGACTCGTCGACGGCGTGCGCGTCGACCAC
CTCGACGGACTATCCGATCCCAGCGGATACTTGGCCCAGCTGCGCGAACTGCTCGGCCCGAACGCCTGGATCGTGGTCGA
AAAAATCCTGGCGGTCGACGAGGCGTTAGAGCCCACGCTGCCAGTGGACGGCTCCACCGGCTATGACGTGCTGCGCGAAA
TAGGTGGCGTCCTCGTTGACCCCCAAGGAGAGTCACCACTGACAGCGCTGGTCGAATCGGCCGGTGTGGACTATCAGGAG
ATGCCGGCGATGTTGGCCGACCTCAAGGTGCACGCGGCCGTCCATACGTTGGCCAGTGAGCTTCGCCGATTGCGGCGATG
CATCGCGGCGGCGGCCGGCGCCGATCATCCGCTGTTGCCCGCGGCGGTGGCTGCACTGCTGCGCCACATCGGACGCTATC
GCTGTGATTACCCCGGCCAAGCCGCCGTCCTACCCTGCGCGTTGGCTGAAACCCATTCGACAACACCACAATTGGCACCT
GGACTGCAGCTGATTGCCGCAGCTGTGGCCCGCGGTGGCGAACCAGCCGTACGCCTGCAACAACTGTGCGGCGCGGTGAG
CGCCAAGGCCGTCGAAGACTGTATGTTCTACCGTGATGCCCGGCTGGTGTCACTCAATGAAGTGGGCGGAGAACCGCGCC
GGTTTGGTGTGGGCGCCGCGGAGTTTCATCACCGGGCCGCCACCCGTGCTCGGTTGTGGCCACGGTCCATGACGACACTG
TCCACCCACGACACCAAACGCGGCGAGGACGTGCGTGCCCGCATCGGCGTGCTGTCCCAAGTGCCGTGGCTGTGGGCCAA
GTTCATCGGCCACGCCCAAGCCATTGCGCCCGCCCCTGATGCCGTGACTGGACAGTTTCTGTGGCAGAACGTCTTCGGAG
TGTGGCCAGTGAGTGGAGAGGTCAGCGCCGCGCTGCGCGGCCGGCTGCACACTTACGCCGAGAAGGCGATCCGGGAGGCG
GCATGGCACACCTCGTGGCACAACCCGAACCGGGCGTTCGAGGACGACGTGCACGGCTGGCTTGATCTGGTGCTCGACGG
ACCGCTGGCGTCCGAGCTGACCGGACTTGTGGCCCACCTCAACTCGCATGCCGAAAGCGACGCGCTGGCCGCTAAGCTGC
TCGCGTTGACCGTGCCTGGCGTACCCGACGTCTACCAGGGCAGCGAACTGTGGGACGACAGCCTGGTCGACCCGGACAAC
CGCCGTCCCGTCGACTACGGCACCCGGCGTGTCGCTCTGAAAGCCTTGCAGCACCCTAAGATTCGGGTGTTGGCCGCGGC
GCTTCGACTGCGGCGCACCCATCCGGAGAGCTTCCTGGGCGGCGCATACCATCCGGTGTTCGCCGCCGGGCCGGCCGCCG
ACCACGTCGTTGCGTTCCGCCGCGGTGACGACATCCTGGTCGCGGTGACCCGCTGGACGGTGCGCCTGCAGCAAACCGGC
TGGGACCACACCGTACTGCCCCTACCCGACGGGTCGTGGACAGATGCCCTCACCGGATTCACGGCCAGTGGGCACACGCC
GGCCGTCGAGCTGTTCGCGGATCTGCCTGTGGTGCTGCTGGTGCGCGACAATGCCTGA

Upstream 100 bases:

>100_bases
CAACGATCCCGTCGGTGACATCGACCTGACGGTAACCGCCACTGACACGTTTTCGGTACCTGCGCGCTCGCTGCTGGTCC
TGCGTAAGACGTTGTGAAAT

Downstream 100 bases:

>100_bases
ATTCCGAGTATGGGCACCCAAACCCGCGCTGGTCCGGCTCGACGTGAACGGTGCGGTACATGCGATGACCCGCTCAGCCG
ACGGCTGGTGGCACACGACG

Product: maltooligosyltrehalose synthase TreY

Products: NA

Alternate protein names: (1,4)-alpha-D-glucan 1-alpha-D-glucosylmutase

Number of amino acids: Translated: 765; Mature: 764

Protein sequence:

>765_residues
MAFPVISTYRVQMRGRSNGFGFTFADAENLLDYLDDLGVSHLYLSPILTAVGGSTHGYDVTDPTTVSPELGGSDGLARLS
AAARSRGMGLIVDIVPSHVGVGKPEQNAWWWDVLKFGRSSAYAEFFDIDWELGDGRIILPLLGSDSDVANLRVDGDLLRL
GDLALPVAPGSGDGTGPAVHDRQHYRLVGWRHGLCGYRRFFSITSLAGLRQEDRAVFDASHAEVARWFTEGLVDGVRVDH
LDGLSDPSGYLAQLRELLGPNAWIVVEKILAVDEALEPTLPVDGSTGYDVLREIGGVLVDPQGESPLTALVESAGVDYQE
MPAMLADLKVHAAVHTLASELRRLRRCIAAAAGADHPLLPAAVAALLRHIGRYRCDYPGQAAVLPCALAETHSTTPQLAP
GLQLIAAAVARGGEPAVRLQQLCGAVSAKAVEDCMFYRDARLVSLNEVGGEPRRFGVGAAEFHHRAATRARLWPRSMTTL
STHDTKRGEDVRARIGVLSQVPWLWAKFIGHAQAIAPAPDAVTGQFLWQNVFGVWPVSGEVSAALRGRLHTYAEKAIREA
AWHTSWHNPNRAFEDDVHGWLDLVLDGPLASELTGLVAHLNSHAESDALAAKLLALTVPGVPDVYQGSELWDDSLVDPDN
RRPVDYGTRRVALKALQHPKIRVLAAALRLRRTHPESFLGGAYHPVFAAGPAADHVVAFRRGDDILVAVTRWTVRLQQTG
WDHTVLPLPDGSWTDALTGFTASGHTPAVELFADLPVVLLVRDNA

Sequences:

>Translated_765_residues
MAFPVISTYRVQMRGRSNGFGFTFADAENLLDYLDDLGVSHLYLSPILTAVGGSTHGYDVTDPTTVSPELGGSDGLARLS
AAARSRGMGLIVDIVPSHVGVGKPEQNAWWWDVLKFGRSSAYAEFFDIDWELGDGRIILPLLGSDSDVANLRVDGDLLRL
GDLALPVAPGSGDGTGPAVHDRQHYRLVGWRHGLCGYRRFFSITSLAGLRQEDRAVFDASHAEVARWFTEGLVDGVRVDH
LDGLSDPSGYLAQLRELLGPNAWIVVEKILAVDEALEPTLPVDGSTGYDVLREIGGVLVDPQGESPLTALVESAGVDYQE
MPAMLADLKVHAAVHTLASELRRLRRCIAAAAGADHPLLPAAVAALLRHIGRYRCDYPGQAAVLPCALAETHSTTPQLAP
GLQLIAAAVARGGEPAVRLQQLCGAVSAKAVEDCMFYRDARLVSLNEVGGEPRRFGVGAAEFHHRAATRARLWPRSMTTL
STHDTKRGEDVRARIGVLSQVPWLWAKFIGHAQAIAPAPDAVTGQFLWQNVFGVWPVSGEVSAALRGRLHTYAEKAIREA
AWHTSWHNPNRAFEDDVHGWLDLVLDGPLASELTGLVAHLNSHAESDALAAKLLALTVPGVPDVYQGSELWDDSLVDPDN
RRPVDYGTRRVALKALQHPKIRVLAAALRLRRTHPESFLGGAYHPVFAAGPAADHVVAFRRGDDILVAVTRWTVRLQQTG
WDHTVLPLPDGSWTDALTGFTASGHTPAVELFADLPVVLLVRDNA
>Mature_764_residues
AFPVISTYRVQMRGRSNGFGFTFADAENLLDYLDDLGVSHLYLSPILTAVGGSTHGYDVTDPTTVSPELGGSDGLARLSA
AARSRGMGLIVDIVPSHVGVGKPEQNAWWWDVLKFGRSSAYAEFFDIDWELGDGRIILPLLGSDSDVANLRVDGDLLRLG
DLALPVAPGSGDGTGPAVHDRQHYRLVGWRHGLCGYRRFFSITSLAGLRQEDRAVFDASHAEVARWFTEGLVDGVRVDHL
DGLSDPSGYLAQLRELLGPNAWIVVEKILAVDEALEPTLPVDGSTGYDVLREIGGVLVDPQGESPLTALVESAGVDYQEM
PAMLADLKVHAAVHTLASELRRLRRCIAAAAGADHPLLPAAVAALLRHIGRYRCDYPGQAAVLPCALAETHSTTPQLAPG
LQLIAAAVARGGEPAVRLQQLCGAVSAKAVEDCMFYRDARLVSLNEVGGEPRRFGVGAAEFHHRAATRARLWPRSMTTLS
THDTKRGEDVRARIGVLSQVPWLWAKFIGHAQAIAPAPDAVTGQFLWQNVFGVWPVSGEVSAALRGRLHTYAEKAIREAA
WHTSWHNPNRAFEDDVHGWLDLVLDGPLASELTGLVAHLNSHAESDALAAKLLALTVPGVPDVYQGSELWDDSLVDPDNR
RPVDYGTRRVALKALQHPKIRVLAAALRLRRTHPESFLGGAYHPVFAAGPAADHVVAFRRGDDILVAVTRWTVRLQQTGW
DHTVLPLPDGSWTDALTGFTASGHTPAVELFADLPVVLLVRDNA

Specific function: Catalyzes the conversion of maltooligosaccharide into the non-reducing saccharide, maltooligosyl trehalose (alpha- maltooligosyl alpha-D-glucoside) by intramolecular transglycosylation

COG id: COG3280

COG function: function code G; Maltooligosyl trehalose synthase

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the glycosyl hydrolase 13 family

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): TREY_MYCTU (Q10768)

Other databases:

- EMBL:   BX842577
- EMBL:   AE000516
- PIR:   H70763
- RefSeq:   NP_336067.1
- RefSeq:   YP_177820.1
- ProteinModelPortal:   Q10768
- SMR:   Q10768
- EnsemblBacteria:   EBMYCT00000000887
- EnsemblBacteria:   EBMYCT00000073002
- GeneID:   886357
- GeneID:   924320
- GenomeReviews:   AE000516_GR
- GenomeReviews:   AL123456_GR
- KEGG:   mtc:MT1614
- KEGG:   mtu:Rv1563c
- TIGR:   MT1614
- TubercuList:   Rv1563c
- GeneTree:   EBGT00050000016660
- HOGENOM:   HBG542942
- OMA:   LLERQHY
- ProtClustDB:   CLSK799817
- BRENDA:   5.4.99.15
- InterPro:   IPR006047
- InterPro:   IPR017853
- InterPro:   IPR013781
- InterPro:   IPR013797
- InterPro:   IPR012767
- Gene3D:   G3DSA:3.20.20.80
- Gene3D:   G3DSA:1.10.10.470
- TIGRFAMs:   TIGR02401

Pfam domain/function: PF00128 Alpha-amylase; SSF51445 Glyco_hydro_cat

EC number: =5.4.99.15

Molecular weight: Translated: 82707; Mature: 82576

Theoretical pI: Translated: 6.13; Mature: 6.13

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.8 %Cys     (Translated Protein)
0.9 %Met     (Translated Protein)
1.7 %Cys+Met (Translated Protein)
0.8 %Cys     (Mature Protein)
0.8 %Met     (Mature Protein)
1.6 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MAFPVISTYRVQMRGRSNGFGFTFADAENLLDYLDDLGVSHLYLSPILTAVGGSTHGYDV
CCCCCEEEEEEEECCCCCCCCEEECCHHHHHHHHHHCCCHHHHHHHHHHHHCCCCCCCCC
TDPTTVSPELGGSDGLARLSAAARSRGMGLIVDIVPSHVGVGKPEQNAWWWDVLKFGRSS
CCCCCCCCCCCCCCHHHHHHHHHHHCCCEEEEEECCCCCCCCCCCCCCHHHHHHHHCCCC
AYAEFFDIDWELGDGRIILPLLGSDSDVANLRVDGDLLRLGDLALPVAPGSGDGTGPAVH
CCEEEEEEEEEECCCEEEEEEECCCCCCEEEEECCCEEEECCEEEEECCCCCCCCCCCCC
DRQHYRLVGWRHGLCGYRRFFSITSLAGLRQEDRAVFDASHAEVARWFTEGLVDGVRVDH
CCCCEEEECCCCCHHHHHHHHHHHHHHCCCHHHHHHHCCHHHHHHHHHHHHHHCCCEEEC
LDGLSDPSGYLAQLRELLGPNAWIVVEKILAVDEALEPTLPVDGSTGYDVLREIGGVLVD
CCCCCCCHHHHHHHHHHHCCCHHHHHHHHHHHHHHCCCCCCCCCCCCHHHHHHHCCEEEC
PQGESPLTALVESAGVDYQEMPAMLADLKVHAAVHTLASELRRLRRCIAAAAGADHPLLP
CCCCCHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCHH
AAVAALLRHIGRYRCDYPGQAAVLPCALAETHSTTPQLAPGLQLIAAAVARGGEPAVRLQ
HHHHHHHHHHHHCCCCCCCCCCEEEEHHHHCCCCCCCCCHHHHHHHHHHHCCCCHHHHHH
QLCGAVSAKAVEDCMFYRDARLVSLNEVGGEPRRFGVGAAEFHHRAATRARLWPRSMTTL
HHHHHHHHHHHHHHHHHHCCEEEEHHHCCCCCHHCCCCHHHHHHHHHHHHHCCCCCCCEE
STHDTKRGEDVRARIGVLSQVPWLWAKFIGHAQAIAPAPDAVTGQFLWQNVFGVWPVSGE
CCCCCCCCCHHHHHHHHHHHHHHHHHHHHCCHHHCCCCCCCHHHHHHHHHHHEECCCCCC
VSAALRGRLHTYAEKAIREAAWHTSWHNPNRAFEDDVHGWLDLVLDGPLASELTGLVAHL
HHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHHCCCCHHHHHHHHHHHH
NSHAESDALAAKLLALTVPGVPDVYQGSELWDDSLVDPDNRRPVDYGTRRVALKALQHPK
HCCCHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHCCCH
IRVLAAALRLRRTHPESFLGGAYHPVFAAGPAADHVVAFRRGDDILVAVTRWTVRLQQTG
HHHHHHHHHHHHCCCHHHHCCCCCCCEECCCCCCCEEEEECCCCEEEEEEEEEEEEECCC
WDHTVLPLPDGSWTDALTGFTASGHTPAVELFADLPVVLLVRDNA
CCEEEEECCCCCCHHHHCCCCCCCCCCHHHHHHCCCEEEEEECCC
>Mature Secondary Structure 
AFPVISTYRVQMRGRSNGFGFTFADAENLLDYLDDLGVSHLYLSPILTAVGGSTHGYDV
CCCCEEEEEEEECCCCCCCCEEECCHHHHHHHHHHCCCHHHHHHHHHHHHCCCCCCCCC
TDPTTVSPELGGSDGLARLSAAARSRGMGLIVDIVPSHVGVGKPEQNAWWWDVLKFGRSS
CCCCCCCCCCCCCCHHHHHHHHHHHCCCEEEEEECCCCCCCCCCCCCCHHHHHHHHCCCC
AYAEFFDIDWELGDGRIILPLLGSDSDVANLRVDGDLLRLGDLALPVAPGSGDGTGPAVH
CCEEEEEEEEEECCCEEEEEEECCCCCCEEEEECCCEEEECCEEEEECCCCCCCCCCCCC
DRQHYRLVGWRHGLCGYRRFFSITSLAGLRQEDRAVFDASHAEVARWFTEGLVDGVRVDH
CCCCEEEECCCCCHHHHHHHHHHHHHHCCCHHHHHHHCCHHHHHHHHHHHHHHCCCEEEC
LDGLSDPSGYLAQLRELLGPNAWIVVEKILAVDEALEPTLPVDGSTGYDVLREIGGVLVD
CCCCCCCHHHHHHHHHHHCCCHHHHHHHHHHHHHHCCCCCCCCCCCCHHHHHHHCCEEEC
PQGESPLTALVESAGVDYQEMPAMLADLKVHAAVHTLASELRRLRRCIAAAAGADHPLLP
CCCCCHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCHH
AAVAALLRHIGRYRCDYPGQAAVLPCALAETHSTTPQLAPGLQLIAAAVARGGEPAVRLQ
HHHHHHHHHHHHCCCCCCCCCCEEEEHHHHCCCCCCCCCHHHHHHHHHHHCCCCHHHHHH
QLCGAVSAKAVEDCMFYRDARLVSLNEVGGEPRRFGVGAAEFHHRAATRARLWPRSMTTL
HHHHHHHHHHHHHHHHHHCCEEEEHHHCCCCCHHCCCCHHHHHHHHHHHHHCCCCCCCEE
STHDTKRGEDVRARIGVLSQVPWLWAKFIGHAQAIAPAPDAVTGQFLWQNVFGVWPVSGE
CCCCCCCCCHHHHHHHHHHHHHHHHHHHHCCHHHCCCCCCCHHHHHHHHHHHEECCCCCC
VSAALRGRLHTYAEKAIREAAWHTSWHNPNRAFEDDVHGWLDLVLDGPLASELTGLVAHL
HHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHHCCCCHHHHHHHHHHHH
NSHAESDALAAKLLALTVPGVPDVYQGSELWDDSLVDPDNRRPVDYGTRRVALKALQHPK
HCCCHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHCCCH
IRVLAAALRLRRTHPESFLGGAYHPVFAAGPAADHVVAFRRGDDILVAVTRWTVRLQQTG
HHHHHHHHHHHHCCCHHHHCCCCCCCEECCCCCCCEEEEECCCCEEEEEEEEEEEEECCC
WDHTVLPLPDGSWTDALTGFTASGHTPAVELFADLPVVLLVRDNA
CCEEEEECCCCCCHHHHCCCCCCCCCCHHHHHHCCCEEEEEECCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 9634230; 12218036