The gene/protein map for NC_008536 is currently unavailable.
Definition Candidatus Solibacter usitatus Ellin6076 chromosome, complete genome.
Accession NC_008536
Length 9,965,640

Click here to switch to the map view.

The map label for this gene is pehX [H]

Identifier: 116626800

GI number: 116626800

Start: 9756112

End: 9757500

Strand: Direct

Name: pehX [H]

Synonym: Acid_7773

Alternate gene names: 116626800

Gene position: 9756112-9757500 (Clockwise)

Preceding gene: 116626794

Following gene: 116626802

Centisome position: 97.9

GC content: 62.13

Gene sequence:

>1389_bases
ATGTCCACCTTTTCTCGCCGCCATGTACTTGCCGCCATGACGGGCGCCGCGTTAGCCGGTTCCCGCGCATGGGCGGCGGA
TGATCCCTGGACCACGGTTTACCCCCAGATCCTCAAACGAATCCAACCCCCAAAAATCGCGGCCAAACAATTTGAGATCA
CCCGGTTCGGCGCCAGGGCAGACGGCAAAACCGATTGCACCGATGCTATCCGCAAAGCCATTGACGAGGCCGCGCGCGTG
GGCGGCGGACGCGTGATGGCGCGCGAAGGCGCCTTCCTGACCGGCGCGATTCATCTCAAGAGCAACGTGAACCTGGTGGT
GGAAAAGGGCGCGACCCTGAGGTTCAGTCCTGACCCGAAGCTCTATCCCATCGTGCTCACCCGCTTCGAAGGCCTCGAGT
GCATGAACTACTCGCCCTTCATCTACGCCTTCAACCAGCAGAACATAGCGATCACCGGCGGCGGCACGCTGGACGGGCAG
GCGAGTGGCGAACATTGGTGGCCGTGGGCCGGAAAACGCGGCGCCAGGCCCGACGACCCGAATCAGCGCAAGGCGCGCGC
TGCTCTCGTCGAGATGGCGGAAAAGGGCGTGCCGGTGGCCGATCGCAAGTTTGGCGACGGCGCCTGGCTTCGCCCCATGT
TCATCCAGCCCTATCGCTGCACCAACGTGCAGATCGAAGACGTCACGATCACCAACTCGCCGATGTACGAGATGCATCCC
GTGCTCTGCAGGAACGTGATCGCGCGCAACGTGAAGGTGTCGAGTCACGGCCCGAATAACGATGGCTGCGATCCCGAATC
CAGCGTGGACGTGCTCATCGATGGCTGCACCTTCGATACCGGCGACGATTGCATCGCGATCAAGAGCGGCCGCAATGCCG
ATGGCCGCAGGTTGCATTCGCCTTCGGAAAATCTGATCGTGCAGAACTGCGTGATGAAAGACGGACACGGCGGCGTCACC
ATGGGCAGCGAATGCTCCGGCGGCATCCGCAATGTCTTCGCGCAGGATTGCCAGATGGATAGCCCGAATCTCAACGTGGC
GCTGCGTTTCAAGAACAATGCCGTCCGCGGCGGCGTCATCGAACACGTCTACATGCGCAACGTGAAAGCCGGCCAGGTCG
CCCAGGCCGCCATCGACGTGGACTTCTATTACGAGGAAGGCGAAAAAGGCTCATTCACCCCGGTCGTCCGCGACGTCGAA
GTCGTCAACCTCGAAGTGAAGAAGTGCACGACCCCCTGGTCCCTGCGCGGGTTCAAAAGCGCGCCGGTCCGCGACATCCG
GATCAGGAACTGCACCTTCGCCGGCGCCACCAAGCCCCCCGTCGCCGAAAACGTAGAAGGCCTGAAGTTGGACAACGTCA
CCGTCAACGGCAAACCCGTCACCGCCTAG

Upstream 100 bases:

>100_bases
TTCCAATGTAAGCATGAAGGGGGTCCAACCAGATTATAGTTCACAGCACCTCCGCCATCCCGCTTGACCGGCGCGATGCC
GGGACCTACCATCGGTTCTG

Downstream 100 bases:

>100_bases
CGAACGACCGTATCGCACATACACCCATTAGCCGGAACCCGAGAACACCGCGGGCCCATGCGAACCGCGGCCGTCAGGGA
GCGATCTCTTGCTGTAGGGC

Product: glycoside hydrolase family protein

Products: NA

Alternate protein names: Exo-PG [H]

Number of amino acids: Translated: 462; Mature: 461

Protein sequence:

>462_residues
MSTFSRRHVLAAMTGAALAGSRAWAADDPWTTVYPQILKRIQPPKIAAKQFEITRFGARADGKTDCTDAIRKAIDEAARV
GGGRVMAREGAFLTGAIHLKSNVNLVVEKGATLRFSPDPKLYPIVLTRFEGLECMNYSPFIYAFNQQNIAITGGGTLDGQ
ASGEHWWPWAGKRGARPDDPNQRKARAALVEMAEKGVPVADRKFGDGAWLRPMFIQPYRCTNVQIEDVTITNSPMYEMHP
VLCRNVIARNVKVSSHGPNNDGCDPESSVDVLIDGCTFDTGDDCIAIKSGRNADGRRLHSPSENLIVQNCVMKDGHGGVT
MGSECSGGIRNVFAQDCQMDSPNLNVALRFKNNAVRGGVIEHVYMRNVKAGQVAQAAIDVDFYYEEGEKGSFTPVVRDVE
VVNLEVKKCTTPWSLRGFKSAPVRDIRIRNCTFAGATKPPVAENVEGLKLDNVTVNGKPVTA

Sequences:

>Translated_462_residues
MSTFSRRHVLAAMTGAALAGSRAWAADDPWTTVYPQILKRIQPPKIAAKQFEITRFGARADGKTDCTDAIRKAIDEAARV
GGGRVMAREGAFLTGAIHLKSNVNLVVEKGATLRFSPDPKLYPIVLTRFEGLECMNYSPFIYAFNQQNIAITGGGTLDGQ
ASGEHWWPWAGKRGARPDDPNQRKARAALVEMAEKGVPVADRKFGDGAWLRPMFIQPYRCTNVQIEDVTITNSPMYEMHP
VLCRNVIARNVKVSSHGPNNDGCDPESSVDVLIDGCTFDTGDDCIAIKSGRNADGRRLHSPSENLIVQNCVMKDGHGGVT
MGSECSGGIRNVFAQDCQMDSPNLNVALRFKNNAVRGGVIEHVYMRNVKAGQVAQAAIDVDFYYEEGEKGSFTPVVRDVE
VVNLEVKKCTTPWSLRGFKSAPVRDIRIRNCTFAGATKPPVAENVEGLKLDNVTVNGKPVTA
>Mature_461_residues
STFSRRHVLAAMTGAALAGSRAWAADDPWTTVYPQILKRIQPPKIAAKQFEITRFGARADGKTDCTDAIRKAIDEAARVG
GGRVMAREGAFLTGAIHLKSNVNLVVEKGATLRFSPDPKLYPIVLTRFEGLECMNYSPFIYAFNQQNIAITGGGTLDGQA
SGEHWWPWAGKRGARPDDPNQRKARAALVEMAEKGVPVADRKFGDGAWLRPMFIQPYRCTNVQIEDVTITNSPMYEMHPV
LCRNVIARNVKVSSHGPNNDGCDPESSVDVLIDGCTFDTGDDCIAIKSGRNADGRRLHSPSENLIVQNCVMKDGHGGVTM
GSECSGGIRNVFAQDCQMDSPNLNVALRFKNNAVRGGVIEHVYMRNVKAGQVAQAAIDVDFYYEEGEKGSFTPVVRDVEV
VNLEVKKCTTPWSLRGFKSAPVRDIRIRNCTFAGATKPPVAENVEGLKLDNVTVNGKPVTA

Specific function: Contributes significantly to bacterial utilization of polygalacturonate and the induction of pectate lyase in the presence of extracellular pectic polymers [H]

COG id: COG5434

COG function: function code M; Endopolygalacturonase

Gene ontology:

Cell location: Secreted [H]

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Contains 4 PbH1 repeats [H]

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR008957
- InterPro:   IPR003961
- InterPro:   IPR000743
- InterPro:   IPR013783
- InterPro:   IPR006626
- InterPro:   IPR012334
- InterPro:   IPR011050 [H]

Pfam domain/function: PF00041 fn3; PF00295 Glyco_hydro_28 [H]

EC number: =3.2.1.82 [H]

Molecular weight: Translated: 50400; Mature: 50269

Theoretical pI: Translated: 8.42; Mature: 8.42

Prosite motif: PS00502 POLYGALACTURONASE

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

2.6 %Cys     (Translated Protein)
2.6 %Met     (Translated Protein)
5.2 %Cys+Met (Translated Protein)
2.6 %Cys     (Mature Protein)
2.4 %Met     (Mature Protein)
5.0 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSTFSRRHVLAAMTGAALAGSRAWAADDPWTTVYPQILKRIQPPKIAAKQFEITRFGARA
CCCCHHHEEEEHHHHHHHCCCCCCCCCCCCCHHHHHHHHHCCCCCCCHHEEEEEEECCCC
DGKTDCTDAIRKAIDEAARVGGGRVMAREGAFLTGAIHLKSNVNLVVEKGATLRFSPDPK
CCCCCHHHHHHHHHHHHHHCCCCEEEEECCCEEEEEEEEECCCEEEEECCCEEEECCCCC
LYPIVLTRFEGLECMNYSPFIYAFNQQNIAITGGGTLDGQASGEHWWPWAGKRGARPDDP
EEEEEEEEECCCEECCCCCEEEEECCCEEEEECCCCCCCCCCCCCCCCCCCCCCCCCCCC
NQRKARAALVEMAEKGVPVADRKFGDGAWLRPMFIQPYRCTNVQIEDVTITNSPMYEMHP
CHHHHHHHHHHHHHCCCCCCCCCCCCCCEECCEEECCEEECCEEEEEEEECCCCCHHHHH
VLCRNVIARNVKVSSHGPNNDGCDPESSVDVLIDGCTFDTGDDCIAIKSGRNADGRRLHS
HHHHHHHHHCEEEECCCCCCCCCCCCCCEEEEEECCCCCCCCCEEEEECCCCCCCCCCCC
PSENLIVQNCVMKDGHGGVTMGSECSGGIRNVFAQDCQMDSPNLNVALRFKNNAVRGGVI
CCCCEEEEEEEEECCCCCCEECCCCCCHHHHHHHHHCCCCCCCCEEEEEECCCCCCCCHH
EHVYMRNVKAGQVAQAAIDVDFYYEEGEKGSFTPVVRDVEVVNLEVKKCTTPWSLRGFKS
HHHHHCCCCCCCEEEEEEEEEEEEECCCCCCCCCEEECEEEEEEEEEECCCCCCCCCCCC
APVRDIRIRNCTFAGATKPPVAENVEGLKLDNVTVNGKPVTA
CCCEEEEEEEEEECCCCCCCHHCCCCCEEECEEEECCCCCCC
>Mature Secondary Structure 
STFSRRHVLAAMTGAALAGSRAWAADDPWTTVYPQILKRIQPPKIAAKQFEITRFGARA
CCCHHHEEEEHHHHHHHCCCCCCCCCCCCCHHHHHHHHHCCCCCCCHHEEEEEEECCCC
DGKTDCTDAIRKAIDEAARVGGGRVMAREGAFLTGAIHLKSNVNLVVEKGATLRFSPDPK
CCCCCHHHHHHHHHHHHHHCCCCEEEEECCCEEEEEEEEECCCEEEEECCCEEEECCCCC
LYPIVLTRFEGLECMNYSPFIYAFNQQNIAITGGGTLDGQASGEHWWPWAGKRGARPDDP
EEEEEEEEECCCEECCCCCEEEEECCCEEEEECCCCCCCCCCCCCCCCCCCCCCCCCCCC
NQRKARAALVEMAEKGVPVADRKFGDGAWLRPMFIQPYRCTNVQIEDVTITNSPMYEMHP
CHHHHHHHHHHHHHCCCCCCCCCCCCCCEECCEEECCEEECCEEEEEEEECCCCCHHHHH
VLCRNVIARNVKVSSHGPNNDGCDPESSVDVLIDGCTFDTGDDCIAIKSGRNADGRRLHS
HHHHHHHHHCEEEECCCCCCCCCCCCCCEEEEEECCCCCCCCCEEEEECCCCCCCCCCCC
PSENLIVQNCVMKDGHGGVTMGSECSGGIRNVFAQDCQMDSPNLNVALRFKNNAVRGGVI
CCCCEEEEEEEEECCCCCCEECCCCCCHHHHHHHHHCCCCCCCCEEEEEECCCCCCCCHH
EHVYMRNVKAGQVAQAAIDVDFYYEEGEKGSFTPVVRDVEVVNLEVKKCTTPWSLRGFKS
HHHHHCCCCCCCEEEEEEEEEEEEECCCCCCCCCEEECEEEEEEEEEECCCCCCCCCCCC
APVRDIRIRNCTFAGATKPPVAENVEGLKLDNVTVNGKPVTA
CCCEEEEEEEEEECCCCCCCHHCCCCCEEECEEEECCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 2168372; 1409594 [H]