Definition Burkholderia mallei NCTC 10247 chromosome II, complete genome.
Accession NC_009079
Length 2,352,693

Click here to switch to the map view.

The map label for this gene is 126446177

Identifier: 126446177

GI number: 126446177

Start: 664027

End: 665691

Strand: Direct

Name: 126446177

Synonym: BMA10247_A0716

Alternate gene names: NA

Gene position: 664027-665691 (Clockwise)

Preceding gene: 126446409

Following gene: 126447238

Centisome position: 28.22

GC content: 66.13

Gene sequence:

>1665_bases
ATGAGCATCGATTCGACTTCCTCCGGCGGCGCGCAGCCGCTCCATCACGGCGCGAACGGCTCGGTTCACGCGCCGCCGCC
GGTCATCGTCGCGCCGAAGGACGACGGCGACCAGCCGTTCTTCGATCCGGTCGCCTACGGCAACGGCCCCGACGATTCGG
TGACGGACACCACCGAGGCCGCCGCGATCACGCACCACACGGTCCGGATCGACGGCCGCACGATCGCGTACACGGCCGCG
GCGGGCCATCTCGTGACCGTCGATCCGAGCAGCTCGCAGCCGGATGCGAAGATCTTCTACGTCGCGTTCACGCAGGACGG
CCAGCAGGAGCAAACGCGCCCCGTCACGTTCTTCTACAACGGCGGGCCGGGCTCGTCGGCCGTGTTCGTGCTGCTCGGCT
CGTTCGCGCCGCGGCGCATCCGCACGTCGATGCCGAGCTTCACGCCGCCCGCGCCGTACCGGATGGAAGACAACCCGGAC
AGCCTGCTCGACAAGAGCGATCTCGTGTTCATCAACCCGGTCGGCACCGGCTATTCGGCGGCGATCGCGCCGCGCAAGAA
CCGCGATTTCTGGGGCGTCGATCAGGACGCGAACTCGATCAAGCAGTTCATCAAGCGCTATCTGACGAAGCACAACCGGT
GGAATTCGCCGAAGTACCTGTTCGGCGAATCGTACGGCACCGCGCGCAGCTGCGTGCTCGCGTACAAGCTGCACGAGGAC
GGCGTCGACCTGAACGGGATCACGCTGCAGTCGTCGATTCTCGATTACCGGCAGGCGGGCAATCCGGTAGGCGCGCTGCC
CACCGCGGCGGCCGACGCGTGGTATCACAAGCGGCTCGGCGTCGCGCCGACGCCGACCGATCTCGGCGCGTTCGTGGAGG
AGGTCGCGCAGTTCGCGCGCACCGACTATCTCGGCGCGCTGCGCAAGTTCCCGCAGGCCGATGCGGCCGTCGTCAAGAAG
CTGTCCGACTACACCGGCATCGACACGACGACGTTGCTGTCGTGGAGCCTCGACATCGCGGGCTACGACGCGCGCGGCAA
CGCGCTGTTCCTCACGACGCTGCTGAAGGCACAAGGCCTCGCGCTCGGCGCGTACGACGGCCGCGTGACGGGAATCGAAT
CGGGGATCGCGGGCCGGATCGATCCGAACTCGGGCGGCAACGATCCGACGATGACGGCTGTGTCGGGCGTCTACACGGCG
ATGTGGAATACGTACCTGAACGAGCAGTTGAAGTACACGTCGAACTCGTCGTTCACCGACCTGAACGACCAGGCATTCAA
GTACTGGGACTTCGGCCACATCGATCCGACGGGCGAACAGCAGGGCGTCGACGCGAAGGGCAACGTGATCCTGTACACGG
CGGGCGATCTCGCCGCGACGATGGCGCTCAACGTCGATCTGAAGGTGCTGTCGGCGAACGGGCTCTACGATTTCGTCACG
CCGTTCTACCAGACGGTGCTCGATCTGCAGCAGATGCCGCTCGAGGACCCGAAGGTGCGGCAGAACCTGTCCGCGCGCTT
CTATCCGTCCGGACACATGGTGTACCTCGACGGCGGCTCGCGCACCACGCTCAAGCACGACCTCGCGCAGATGTACGAAT
CGACGGTGCGCGACACCGCGGCGGTGATGCGCATTCGCGCGTTGCAGGAGAAAAAGCGCGCGTAG

Upstream 100 bases:

>100_bases
CGCAGCGGCAGCGGCGCGCGCGACCGGTGTCGGCGGCAAACGGCTTGGCACGATTGACGATTCGTTCATGCACCCTCAAT
CGCACAGAAGGAGCAGCACG

Downstream 100 bases:

>100_bases
CGCAGCGCGATTCGCCGCCGGCGGCAAGCGCCCGACGACGCCTCGACCCTCGGCGGCGAGGCGTCGTCGGGCGCGCATGA
CCGCCGCCGCGGCGGCCCTT

Product: serine carboxypeptidase family protein

Products: NA

Alternate protein names: Serine Carboxypeptidase Family Protein; Carboxypeptidase-Related Protein; Serine Carboxypeptidase; Carboxypeptidase C; Serine-Type Carboxypeptidase Family Protein; S10 Family Peptidase; Carboxypeptidase; S10 Family Carboxypeptidase; Carboxypeptidase-Like Protein; Serine Carboxypeptidase Superfamily; Peptidase S

Number of amino acids: Translated: 554; Mature: 553

Protein sequence:

>554_residues
MSIDSTSSGGAQPLHHGANGSVHAPPPVIVAPKDDGDQPFFDPVAYGNGPDDSVTDTTEAAAITHHTVRIDGRTIAYTAA
AGHLVTVDPSSSQPDAKIFYVAFTQDGQQEQTRPVTFFYNGGPGSSAVFVLLGSFAPRRIRTSMPSFTPPAPYRMEDNPD
SLLDKSDLVFINPVGTGYSAAIAPRKNRDFWGVDQDANSIKQFIKRYLTKHNRWNSPKYLFGESYGTARSCVLAYKLHED
GVDLNGITLQSSILDYRQAGNPVGALPTAAADAWYHKRLGVAPTPTDLGAFVEEVAQFARTDYLGALRKFPQADAAVVKK
LSDYTGIDTTTLLSWSLDIAGYDARGNALFLTTLLKAQGLALGAYDGRVTGIESGIAGRIDPNSGGNDPTMTAVSGVYTA
MWNTYLNEQLKYTSNSSFTDLNDQAFKYWDFGHIDPTGEQQGVDAKGNVILYTAGDLAATMALNVDLKVLSANGLYDFVT
PFYQTVLDLQQMPLEDPKVRQNLSARFYPSGHMVYLDGGSRTTLKHDLAQMYESTVRDTAAVMRIRALQEKKRA

Sequences:

>Translated_554_residues
MSIDSTSSGGAQPLHHGANGSVHAPPPVIVAPKDDGDQPFFDPVAYGNGPDDSVTDTTEAAAITHHTVRIDGRTIAYTAA
AGHLVTVDPSSSQPDAKIFYVAFTQDGQQEQTRPVTFFYNGGPGSSAVFVLLGSFAPRRIRTSMPSFTPPAPYRMEDNPD
SLLDKSDLVFINPVGTGYSAAIAPRKNRDFWGVDQDANSIKQFIKRYLTKHNRWNSPKYLFGESYGTARSCVLAYKLHED
GVDLNGITLQSSILDYRQAGNPVGALPTAAADAWYHKRLGVAPTPTDLGAFVEEVAQFARTDYLGALRKFPQADAAVVKK
LSDYTGIDTTTLLSWSLDIAGYDARGNALFLTTLLKAQGLALGAYDGRVTGIESGIAGRIDPNSGGNDPTMTAVSGVYTA
MWNTYLNEQLKYTSNSSFTDLNDQAFKYWDFGHIDPTGEQQGVDAKGNVILYTAGDLAATMALNVDLKVLSANGLYDFVT
PFYQTVLDLQQMPLEDPKVRQNLSARFYPSGHMVYLDGGSRTTLKHDLAQMYESTVRDTAAVMRIRALQEKKRA
>Mature_553_residues
SIDSTSSGGAQPLHHGANGSVHAPPPVIVAPKDDGDQPFFDPVAYGNGPDDSVTDTTEAAAITHHTVRIDGRTIAYTAAA
GHLVTVDPSSSQPDAKIFYVAFTQDGQQEQTRPVTFFYNGGPGSSAVFVLLGSFAPRRIRTSMPSFTPPAPYRMEDNPDS
LLDKSDLVFINPVGTGYSAAIAPRKNRDFWGVDQDANSIKQFIKRYLTKHNRWNSPKYLFGESYGTARSCVLAYKLHEDG
VDLNGITLQSSILDYRQAGNPVGALPTAAADAWYHKRLGVAPTPTDLGAFVEEVAQFARTDYLGALRKFPQADAAVVKKL
SDYTGIDTTTLLSWSLDIAGYDARGNALFLTTLLKAQGLALGAYDGRVTGIESGIAGRIDPNSGGNDPTMTAVSGVYTAM
WNTYLNEQLKYTSNSSFTDLNDQAFKYWDFGHIDPTGEQQGVDAKGNVILYTAGDLAATMALNVDLKVLSANGLYDFVTP
FYQTVLDLQQMPLEDPKVRQNLSARFYPSGHMVYLDGGSRTTLKHDLAQMYESTVRDTAAVMRIRALQEKKRA

Specific function: Unknown

COG id: COG2939

COG function: function code E; Carboxypeptidase C (cathepsin A)

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 60164; Mature: 60033

Theoretical pI: Translated: 5.77; Mature: 5.77

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.2 %Cys     (Translated Protein)
1.8 %Met     (Translated Protein)
2.0 %Cys+Met (Translated Protein)
0.2 %Cys     (Mature Protein)
1.6 %Met     (Mature Protein)
1.8 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSIDSTSSGGAQPLHHGANGSVHAPPPVIVAPKDDGDQPFFDPVAYGNGPDDSVTDTTEA
CCCCCCCCCCCCCCCCCCCCCCCCCCCEEECCCCCCCCCCCCCCCCCCCCCCCCCCCHHH
AAITHHTVRIDGRTIAYTAAAGHLVTVDPSSSQPDAKIFYVAFTQDGQQEQTRPVTFFYN
HEEEEEEEEECCCEEEEEECCCEEEEECCCCCCCCCEEEEEEECCCCCCCCCCCEEEEEC
GGPGSSAVFVLLGSFAPRRIRTSMPSFTPPAPYRMEDNPDSLLDKSDLVFINPVGTGYSA
CCCCCCEEEEEECCCCCHHHHHCCCCCCCCCCCCCCCCHHHHCCCCCEEEEEECCCCCEE
AIAPRKNRDFWGVDQDANSIKQFIKRYLTKHNRWNSPKYLFGESYGTARSCVLAYKLHED
EECCCCCCCCCCCCCCHHHHHHHHHHHHHHCCCCCCCCEEECCCCCCHHEEEEEEEECCC
GVDLNGITLQSSILDYRQAGNPVGALPTAAADAWYHKRLGVAPTPTDLGAFVEEVAQFAR
CCCCCCEEEHHHHHHHHHCCCCCCCCCCHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHH
TDYLGALRKFPQADAAVVKKLSDYTGIDTTTLLSWSLDIAGYDARGNALFLTTLLKAQGL
HHHHHHHHHCCCHHHHHHHHHHHCCCCCCEEEEEEEEEEEEECCCCCEEEEEEHHHHCCC
ALGAYDGRVTGIESGIAGRIDPNSGGNDPTMTAVSGVYTAMWNTYLNEQLKYTSNSSFTD
EEECCCCEEEEECCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHEECCCCCCCC
LNDQAFKYWDFGHIDPTGEQQGVDAKGNVILYTAGDLAATMALNVDLKVLSANGLYDFVT
CCCCCEEEECCCCCCCCCCCCCCCCCCCEEEEECCCEEEEEEEEEEEEEEECCCCHHHHH
PFYQTVLDLQQMPLEDPKVRQNLSARFYPSGHMVYLDGGSRTTLKHDLAQMYESTVRDTA
HHHHHHHHHHHCCCCCCHHHHCCCEEECCCCCEEEEECCCCCHHHHHHHHHHHHHHHHHH
AVMRIRALQEKKRA
HHHHHHHHHHHHCC
>Mature Secondary Structure 
SIDSTSSGGAQPLHHGANGSVHAPPPVIVAPKDDGDQPFFDPVAYGNGPDDSVTDTTEA
CCCCCCCCCCCCCCCCCCCCCCCCCCEEECCCCCCCCCCCCCCCCCCCCCCCCCCCHHH
AAITHHTVRIDGRTIAYTAAAGHLVTVDPSSSQPDAKIFYVAFTQDGQQEQTRPVTFFYN
HEEEEEEEEECCCEEEEEECCCEEEEECCCCCCCCCEEEEEEECCCCCCCCCCCEEEEEC
GGPGSSAVFVLLGSFAPRRIRTSMPSFTPPAPYRMEDNPDSLLDKSDLVFINPVGTGYSA
CCCCCCEEEEEECCCCCHHHHHCCCCCCCCCCCCCCCCHHHHCCCCCEEEEEECCCCCEE
AIAPRKNRDFWGVDQDANSIKQFIKRYLTKHNRWNSPKYLFGESYGTARSCVLAYKLHED
EECCCCCCCCCCCCCCHHHHHHHHHHHHHHCCCCCCCCEEECCCCCCHHEEEEEEEECCC
GVDLNGITLQSSILDYRQAGNPVGALPTAAADAWYHKRLGVAPTPTDLGAFVEEVAQFAR
CCCCCCEEEHHHHHHHHHCCCCCCCCCCHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHH
TDYLGALRKFPQADAAVVKKLSDYTGIDTTTLLSWSLDIAGYDARGNALFLTTLLKAQGL
HHHHHHHHHCCCHHHHHHHHHHHCCCCCCEEEEEEEEEEEEECCCCCEEEEEEHHHHCCC
ALGAYDGRVTGIESGIAGRIDPNSGGNDPTMTAVSGVYTAMWNTYLNEQLKYTSNSSFTD
EEECCCCEEEEECCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHEECCCCCCCC
LNDQAFKYWDFGHIDPTGEQQGVDAKGNVILYTAGDLAATMALNVDLKVLSANGLYDFVT
CCCCCEEEECCCCCCCCCCCCCCCCCCCEEEEECCCEEEEEEEEEEEEEEECCCCHHHHH
PFYQTVLDLQQMPLEDPKVRQNLSARFYPSGHMVYLDGGSRTTLKHDLAQMYESTVRDTA
HHHHHHHHHHHCCCCCCHHHHCCCEEECCCCCEEEEECCCCCHHHHHHHHHHHHHHHHHH
AVMRIRALQEKKRA
HHHHHHHHHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA