| Definition | Burkholderia pseudomallei 668 chromosome chromosome II, complete sequence. |
|---|---|
| Accession | NC_009075 |
| Length | 3,127,456 |
Click here to switch to the map view.
The map label for this gene is cga [H]
Identifier: 126442408
GI number: 126442408
Start: 255228
End: 257876
Strand: Reverse
Name: cga [H]
Synonym: BURPS668_A0289
Alternate gene names: 126442408
Gene position: 257876-255228 (Counterclockwise)
Preceding gene: 126444776
Following gene: 126443393
Centisome position: 8.25
GC content: 68.33
Gene sequence:
>2649_bases ATGTCGGCAAGGCACTTCGGATTCAGGCAGGCGGTGCTGGTGGGCAGTCTGGCCGCGCTCGCGGGCGCGGCGGCCCTACC GGCGAATACTTCGGCCGCCGCCGAAGCATTCGGCTCGCCCGGCGCCGCGCCCGTGCGGGGCCCGGCGGCCAAGTCGTTCC TCGGCACGGCGGTCAACGGCGCATCGCGGGTGTACTTCACCGGTTATCGCGGCATCCTGTCCGAGGTCTACTACCCGGTC CTCGATACGCCCGAGTCCGTCGACCTGCAGTTCCTCGTCGGCGACGCCGGCAAGACCTTCGTCGACGAAGAAAAGCAGCA GGCCTACTCGGCCGCGCAAACGGACACGCGCACGATGAGCTGGCAGGTGACAACCGGCAACAGTTCGCACAACTGGCAAA TTCGCAAGATCGTCTTCGCCGATCCGAACCACAACGCGATCGTGCAGCGCGTCACGTTCACCGCGCTCAACGGCCGCAAG GTGGGCGACTTCAATCTCTACATGCTGTCCAAGCCGTACCTCGACAACGCCGGCGCCAACAATACCGCGCAAACGGTATC CGGCAGCGGCGGCACCGCGCTCGTCGCGAATCACAACAGCCGCTATTCGGCGCTCGTCGCGAGCCGCCCGTGGAAGGTGG TCAACGGCGTGGGCATGACGTCGAACGGCTTCGTCGGGCAAAGCGACGGCTGGACCGACCTGCTCGGCGGCACCGCCGAC AAGACGATGGACTGGACCTTCTCGTCCGCGACCAACGGCAACGCCGCGCAGATGGGCTGGCTCGACCTCGGCGATCCGAG CGCGACGAGCGTGTCGTTCGACGTCGTGCTCGGCTTCGGCGGCACGCAGGACCAGGCGCTCGGCGACGCGAACACGGTGC TCGGCAGCGATCTCGCCGGCGAGCAGCAGCAGTATGACACCGGGTGGCATAACTACGCGGCGGGCCTGTCGTCGCAGAAC GGCGCCGCGGACGACGGCTACTACCTGGCCGCGATGACGCTCAAGACGATGCAGGACAAGAGCAACGGCGCGATGATCGC CGGCATCGGCACGCCGTGGGGCGAAACGCAGGGCGATGCGAACGCGGGCGGCTATCACCTCGTGTGGCCGCGCGACCTGT TCAAGTTCGCGAACGCGCTGACGACGGCGGGCGACACGTCGAGCGCGACGAGCGTCGTCAACTACCTGTTCAACACGCTG CAGCAGACGACCGATTGCGGCACCGCCGAATACAACGCGCCCGGCTGCGCGCAGGGCTACAGCCGCGTCGGGCGCTTTCC GCAGAACGCATGGGTGAACGGCTGGCCGTACTGGCAGGGCACGCAGATGGACGAGCAGGCGATGCCGATCATCCTCGCGT GGCGCCTCGGCCCGAGCGTGTTCAATCCGCTGTGGCCGAAGATCAAGCTCACCGCCGACTACATCGTCAATACCGGCCCC TGGACGTACCAGGAGCGCTGGGAGGAGAACGCCGGCTATTCGCCGTCGACGATCGCCGCCGAGATCGCGGGCCTCGTCAC GGCGGCCGACATCGCGACGCAAAACGGCGACACGGCGAGCGCCGCGCGCTACCTCGCCGCGGCCGACTACTGGCAGGAGA ACGTCGCGGCGTGGACGTACACGTCGAGCGGCGCGTTCGGCAACGGCAGCTACTACATCCGGATCAATCCGGCGGGCCGC GCGGGCACCGGCACCGACCGCGCGAGCTTCGCGCCGACCGCCGGCCCCGACACGCCGCAGACGCTGAGCGTGAAGAACGG CGGCGGCAGCCACGACGCGCGGCGCGTCGTCGACGGCGGCTTCTTCGAGCTCGTCCGAATGGGGGTCAAGCGCGCGACCG ATCCGACGATCGCCAACACGATCTCGGTCTACGACAGCGTGCTCGGCCAGACGCTGAACGTCGCGAACGCGCCGGCGCTG TCGCCGAACGCGTGGTTCCGCTACAACTTCGACGGCTACGGCGAGCACAACGACGGCGGCGATTTCGACGGCACCGGCGC CGGCCGGCTGTGGCCGATCTTCACCGCCGAGCGCGGCATGGTCGAGATCGCGCGCCAGGGCAGCGGCGGCGCGGGCAGCG CGTACTTCTCGACGCTCAAGCAATTGACGACACCCGAGGGCTTCGTGCCGGAGCAGGTGTGGTCGAATTCGACGACGCTG CCCGACGGCTGGGCGGTGACGACGCCCGCGGGCTACACGCCGGGCCAGCCGACCAAATCGATGGCGCCGCTCAACTGGGC GATGGGCGAATACATCAGCCTGCTCGCGTCGATCCAGGCGGGGCGCATCGTCGACGTGCCGTCGGTGGTCTGCGCGCGCT ACAACAACTGCGCCGCGCCGCCGCAAAGCGGGCAGGTGCCGGTGGCCGTCAACGTGAACGCGAGCACGCAGCTCGGCCAG CAGATGTACGTGACAGGCAACGTCGCCGCGCTCGGCAACTGGAACACCGATCTCGGCATTCCGGTCGATCCGGCCAGCTA CCCGGTGTGGCGCAACACCGTCAACCTGCCGGCCGCTCAGGCGATCCAGTACAAGTACTACCGGAAGAACGCAGACGGCA GCGTGACGTGGGAGAACCGTTCCGGCAACCGCCAGCTTCAGACGCCCGCGAGCGGCACGTTGGCGCTGAACGATCAGGTG AGCTGGTGA
Upstream 100 bases:
>100_bases TCATTGAAAATATTGACTCTTTCGACTTCGCATGAGATACAGCGGATGTTGTTTTGCTACAAGAATCACAACAGACGCAT TCATAACGGAGACGAAAAAA
Downstream 100 bases:
>100_bases TGACGCCGCGCATGCGCTGGATCGCGCTCGCGGCCGCGACGCTGCTGGGCGCGGCGGCGGCGGGCTGGCGGGTGCGGCCG CCGGCGGCCCGGGATGCGGC
Product: glycosy hydrolase family protein
Products: NA
Alternate protein names: 1,4-alpha-D-glucan glucohydrolase; Glucan 1,4-alpha-glucosidase [H]
Number of amino acids: Translated: 882; Mature: 881
Protein sequence:
>882_residues MSARHFGFRQAVLVGSLAALAGAAALPANTSAAAEAFGSPGAAPVRGPAAKSFLGTAVNGASRVYFTGYRGILSEVYYPV LDTPESVDLQFLVGDAGKTFVDEEKQQAYSAAQTDTRTMSWQVTTGNSSHNWQIRKIVFADPNHNAIVQRVTFTALNGRK VGDFNLYMLSKPYLDNAGANNTAQTVSGSGGTALVANHNSRYSALVASRPWKVVNGVGMTSNGFVGQSDGWTDLLGGTAD KTMDWTFSSATNGNAAQMGWLDLGDPSATSVSFDVVLGFGGTQDQALGDANTVLGSDLAGEQQQYDTGWHNYAAGLSSQN GAADDGYYLAAMTLKTMQDKSNGAMIAGIGTPWGETQGDANAGGYHLVWPRDLFKFANALTTAGDTSSATSVVNYLFNTL QQTTDCGTAEYNAPGCAQGYSRVGRFPQNAWVNGWPYWQGTQMDEQAMPIILAWRLGPSVFNPLWPKIKLTADYIVNTGP WTYQERWEENAGYSPSTIAAEIAGLVTAADIATQNGDTASAARYLAAADYWQENVAAWTYTSSGAFGNGSYYIRINPAGR AGTGTDRASFAPTAGPDTPQTLSVKNGGGSHDARRVVDGGFFELVRMGVKRATDPTIANTISVYDSVLGQTLNVANAPAL SPNAWFRYNFDGYGEHNDGGDFDGTGAGRLWPIFTAERGMVEIARQGSGGAGSAYFSTLKQLTTPEGFVPEQVWSNSTTL PDGWAVTTPAGYTPGQPTKSMAPLNWAMGEYISLLASIQAGRIVDVPSVVCARYNNCAAPPQSGQVPVAVNVNASTQLGQ QMYVTGNVAALGNWNTDLGIPVDPASYPVWRNTVNLPAAQAIQYKYYRKNADGSVTWENRSGNRQLQTPASGTLALNDQV SW
Sequences:
>Translated_882_residues MSARHFGFRQAVLVGSLAALAGAAALPANTSAAAEAFGSPGAAPVRGPAAKSFLGTAVNGASRVYFTGYRGILSEVYYPV LDTPESVDLQFLVGDAGKTFVDEEKQQAYSAAQTDTRTMSWQVTTGNSSHNWQIRKIVFADPNHNAIVQRVTFTALNGRK VGDFNLYMLSKPYLDNAGANNTAQTVSGSGGTALVANHNSRYSALVASRPWKVVNGVGMTSNGFVGQSDGWTDLLGGTAD KTMDWTFSSATNGNAAQMGWLDLGDPSATSVSFDVVLGFGGTQDQALGDANTVLGSDLAGEQQQYDTGWHNYAAGLSSQN GAADDGYYLAAMTLKTMQDKSNGAMIAGIGTPWGETQGDANAGGYHLVWPRDLFKFANALTTAGDTSSATSVVNYLFNTL QQTTDCGTAEYNAPGCAQGYSRVGRFPQNAWVNGWPYWQGTQMDEQAMPIILAWRLGPSVFNPLWPKIKLTADYIVNTGP WTYQERWEENAGYSPSTIAAEIAGLVTAADIATQNGDTASAARYLAAADYWQENVAAWTYTSSGAFGNGSYYIRINPAGR AGTGTDRASFAPTAGPDTPQTLSVKNGGGSHDARRVVDGGFFELVRMGVKRATDPTIANTISVYDSVLGQTLNVANAPAL SPNAWFRYNFDGYGEHNDGGDFDGTGAGRLWPIFTAERGMVEIARQGSGGAGSAYFSTLKQLTTPEGFVPEQVWSNSTTL PDGWAVTTPAGYTPGQPTKSMAPLNWAMGEYISLLASIQAGRIVDVPSVVCARYNNCAAPPQSGQVPVAVNVNASTQLGQ QMYVTGNVAALGNWNTDLGIPVDPASYPVWRNTVNLPAAQAIQYKYYRKNADGSVTWENRSGNRQLQTPASGTLALNDQV SW >Mature_881_residues SARHFGFRQAVLVGSLAALAGAAALPANTSAAAEAFGSPGAAPVRGPAAKSFLGTAVNGASRVYFTGYRGILSEVYYPVL DTPESVDLQFLVGDAGKTFVDEEKQQAYSAAQTDTRTMSWQVTTGNSSHNWQIRKIVFADPNHNAIVQRVTFTALNGRKV GDFNLYMLSKPYLDNAGANNTAQTVSGSGGTALVANHNSRYSALVASRPWKVVNGVGMTSNGFVGQSDGWTDLLGGTADK TMDWTFSSATNGNAAQMGWLDLGDPSATSVSFDVVLGFGGTQDQALGDANTVLGSDLAGEQQQYDTGWHNYAAGLSSQNG AADDGYYLAAMTLKTMQDKSNGAMIAGIGTPWGETQGDANAGGYHLVWPRDLFKFANALTTAGDTSSATSVVNYLFNTLQ QTTDCGTAEYNAPGCAQGYSRVGRFPQNAWVNGWPYWQGTQMDEQAMPIILAWRLGPSVFNPLWPKIKLTADYIVNTGPW TYQERWEENAGYSPSTIAAEIAGLVTAADIATQNGDTASAARYLAAADYWQENVAAWTYTSSGAFGNGSYYIRINPAGRA GTGTDRASFAPTAGPDTPQTLSVKNGGGSHDARRVVDGGFFELVRMGVKRATDPTIANTISVYDSVLGQTLNVANAPALS PNAWFRYNFDGYGEHNDGGDFDGTGAGRLWPIFTAERGMVEIARQGSGGAGSAYFSTLKQLTTPEGFVPEQVWSNSTTLP DGWAVTTPAGYTPGQPTKSMAPLNWAMGEYISLLASIQAGRIVDVPSVVCARYNNCAAPPQSGQVPVAVNVNASTQLGQQ MYVTGNVAALGNWNTDLGIPVDPASYPVWRNTVNLPAAQAIQYKYYRKNADGSVTWENRSGNRQLQTPASGTLALNDQVS W
Specific function: CGA has typical kinetic properties for a glucoamylase, but this bacterial enzyme had higher isomaltose-hydrolyzing activity than other eukaryotic glucoamylases [H]
COG id: COG3387
COG function: function code G; Glucoamylase and related glycosyl hydrolases
Gene ontology:
Cell location: Cell membrane; Lipid-anchor [H]
Metaboloic importance: NA
Operon status: Not Known
Operon components: None
Similarity: Belongs to the glycosyl hydrolase 15 family [H]
Homologues:
None
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR008928 - InterPro: IPR012341 - InterPro: IPR006425 - InterPro: IPR015220 - InterPro: IPR011013 - InterPro: IPR014718 - InterPro: IPR000165 - InterPro: IPR011613 [H]
Pfam domain/function: PF09137 Glucodextran_N; PF00723 Glyco_hydro_15 [H]
EC number: =3.2.1.3 [H]
Molecular weight: Translated: 93569; Mature: 93438
Theoretical pI: Translated: 4.85; Mature: 4.85
Prosite motif: PS51166 CBM20
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.5 %Cys (Translated Protein) 1.8 %Met (Translated Protein) 2.3 %Cys+Met (Translated Protein) 0.5 %Cys (Mature Protein) 1.7 %Met (Mature Protein) 2.2 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MSARHFGFRQAVLVGSLAALAGAAALPANTSAAAEAFGSPGAAPVRGPAAKSFLGTAVNG CCCCCCCHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHCCCCCCCCCCCHHHHHHHHHCCC ASRVYFTGYRGILSEVYYPVLDTPESVDLQFLVGDAGKTFVDEEKQQAYSAAQTDTRTMS CCEEEEECHHHHHHHHHHHHCCCCCCCEEEEEECCCCCCHHHHHHHHHHHHHCCCCEEEE WQVTTGNSSHNWQIRKIVFADPNHNAIVQRVTFTALNGRKVGDFNLYMLSKPYLDNAGAN EEEEECCCCCCEEEEEEEEECCCCCEEEEEEEEEEECCCEECCEEEEEEECCCCCCCCCC NTAQTVSGSGGTALVANHNSRYSALVASRPWKVVNGVGMTSNGFVGQSDGWTDLLGGTAD CCCEEECCCCCEEEEEECCCCEEEEEECCCEEEEECCCCCCCCCCCCCCCCHHHHCCCCC KTMDWTFSSATNGNAAQMGWLDLGDPSATSVSFDVVLGFGGTQDQALGDANTVLGSDLAG CCEEEEECCCCCCCCEEECEEECCCCCCCEEEEEEEEECCCCCCCCCCCCHHHHCCCCCC EQQQYDTGWHNYAAGLSSQNGAADDGYYLAAMTLKTMQDKSNGAMIAGIGTPWGETQGDA CHHHHCCCHHHHHCCCCCCCCCCCCCEEEEEEEEEHHHCCCCCEEEEECCCCCCCCCCCC NAGGYHLVWPRDLFKFANALTTAGDTSSATSVVNYLFNTLQQTTDCGTAEYNAPGCAQGY CCCCEEEECHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHCCCCCCCCCCCCHHHHH SRVGRFPQNAWVNGWPYWQGTQMDEQAMPIILAWRLGPSVFNPLWPKIKLTADYIVNTGP HHHCCCCCCCCCCCCCCCCCCCCCCCCCCEEEEEECCHHHHCCCCCEEEEEEEEEEECCC WTYQERWEENAGYSPSTIAAEIAGLVTAADIATQNGDTASAARYLAAADYWQENVAAWTY CCHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHCCCEEEEE TSSGAFGNGSYYIRINPAGRAGTGTDRASFAPTAGPDTPQTLSVKNGGGSHDARRVVDGG ECCCCCCCCEEEEEECCCCCCCCCCCCCCCCCCCCCCCCCEEEECCCCCCCHHHHHHCCH FFELVRMGVKRATDPTIANTISVYDSVLGQTLNVANAPALSPNAWFRYNFDGYGEHNDGG HHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHCCCCCCCCCCCCCEEEECCCCCCCCCCCC DFDGTGAGRLWPIFTAERGMVEIARQGSGGAGSAYFSTLKQLTTPEGFVPEQVWSNSTTL CCCCCCCCCEEEEEECCCCHHHHHHCCCCCCCHHHHHHHHHHCCCCCCCCHHHHCCCCCC PDGWAVTTPAGYTPGQPTKSMAPLNWAMGEYISLLASIQAGRIVDVPSVVCARYNNCAAP CCCEEECCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHCCCCEECCHHHHHHHCCCCCCC PQSGQVPVAVNVNASTQLGQQMYVTGNVAALGNWNTDLGIPVDPASYPVWRNTVNLPAAQ CCCCCEEEEEECCCCHHCCCEEEEEECEEEECCCCCCCCCCCCCCCCCCCCCCCCCCHHH AIQYKYYRKNADGSVTWENRSGNRQLQTPASGTLALNDQVSW HHEEEEEEECCCCEEEECCCCCCCEEECCCCCEEEECCCCCC >Mature Secondary Structure SARHFGFRQAVLVGSLAALAGAAALPANTSAAAEAFGSPGAAPVRGPAAKSFLGTAVNG CCCCCCHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHCCCCCCCCCCCHHHHHHHHHCCC ASRVYFTGYRGILSEVYYPVLDTPESVDLQFLVGDAGKTFVDEEKQQAYSAAQTDTRTMS CCEEEEECHHHHHHHHHHHHCCCCCCCEEEEEECCCCCCHHHHHHHHHHHHHCCCCEEEE WQVTTGNSSHNWQIRKIVFADPNHNAIVQRVTFTALNGRKVGDFNLYMLSKPYLDNAGAN EEEEECCCCCCEEEEEEEEECCCCCEEEEEEEEEEECCCEECCEEEEEEECCCCCCCCCC NTAQTVSGSGGTALVANHNSRYSALVASRPWKVVNGVGMTSNGFVGQSDGWTDLLGGTAD CCCEEECCCCCEEEEEECCCCEEEEEECCCEEEEECCCCCCCCCCCCCCCCHHHHCCCCC KTMDWTFSSATNGNAAQMGWLDLGDPSATSVSFDVVLGFGGTQDQALGDANTVLGSDLAG CCEEEEECCCCCCCCEEECEEECCCCCCCEEEEEEEEECCCCCCCCCCCCHHHHCCCCCC EQQQYDTGWHNYAAGLSSQNGAADDGYYLAAMTLKTMQDKSNGAMIAGIGTPWGETQGDA CHHHHCCCHHHHHCCCCCCCCCCCCCEEEEEEEEEHHHCCCCCEEEEECCCCCCCCCCCC NAGGYHLVWPRDLFKFANALTTAGDTSSATSVVNYLFNTLQQTTDCGTAEYNAPGCAQGY CCCCEEEECHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHCCCCCCCCCCCCHHHHH SRVGRFPQNAWVNGWPYWQGTQMDEQAMPIILAWRLGPSVFNPLWPKIKLTADYIVNTGP HHHCCCCCCCCCCCCCCCCCCCCCCCCCCEEEEEECCHHHHCCCCCEEEEEEEEEEECCC WTYQERWEENAGYSPSTIAAEIAGLVTAADIATQNGDTASAARYLAAADYWQENVAAWTY CCHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHCCCEEEEE TSSGAFGNGSYYIRINPAGRAGTGTDRASFAPTAGPDTPQTLSVKNGGGSHDARRVVDGG ECCCCCCCCEEEEEECCCCCCCCCCCCCCCCCCCCCCCCCEEEECCCCCCCHHHHHHCCH FFELVRMGVKRATDPTIANTISVYDSVLGQTLNVANAPALSPNAWFRYNFDGYGEHNDGG HHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHCCCCCCCCCCCCCEEEECCCCCCCCCCCC DFDGTGAGRLWPIFTAERGMVEIARQGSGGAGSAYFSTLKQLTTPEGFVPEQVWSNSTTL CCCCCCCCCEEEEEECCCCHHHHHHCCCCCCCHHHHHHHHHHCCCCCCCCHHHHCCCCCC PDGWAVTTPAGYTPGQPTKSMAPLNWAMGEYISLLASIQAGRIVDVPSVVCARYNNCAAP CCCEEECCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHCCCCEECCHHHHHHHCCCCCCC PQSGQVPVAVNVNASTQLGQQMYVTGNVAALGNWNTDLGIPVDPASYPVWRNTVNLPAAQ CCCCCEEEEEECCCCHHCCCEEEEEECEEEECCCCCCCCCCCCCCCCCCCCCCCCCCHHH AIQYKYYRKNADGSVTWENRSGNRQLQTPASGTLALNDQVSW HHEEEEEEECCCCEEEECCCCCCCEEECCCCCEEEECCCCCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 6.0
TargetDB status: NA
Availability: NA
References: 1633799 [H]