Definition Gluconacetobacter diazotrophicus PAl 5 chromosome, complete genome.
Accession NC_010125
Length 3,944,163

Click here to switch to the map view.

The map label for this gene is 162148876

Identifier: 162148876

GI number: 162148876

Start: 3200191

End: 3201867

Strand: Direct

Name: 162148876

Synonym: GDI_3106

Alternate gene names: NA

Gene position: 3200191-3201867 (Clockwise)

Preceding gene: 162148875

Following gene: 162148878

Centisome position: 81.14

GC content: 68.63

Gene sequence:

>1677_bases
ATGTCGATTTTGTTCAAAGACCTCGCCTTCCCCACCCCTACGGCCGACGGCCTGGCCGCCGCGTTCGGCCGCGTGACGGC
GTTGCTGGATGCCGGCCAGCGCGACCAGGCCCTGGCGCTGTTCGATACCGAACGCCGGGCCTATGACAGTTGGGCGTCGC
TGGTCGCGCTGCGCTTCGCCCAGGACACCACCGACCCGCAGGCCCGTGCCGACCGCGACCTGGCCGACAGCCTGACCCCG
CGCGTGACCGAGCACGAGATCGCGATCAAGCGCCGGCTGCTGGACGACCCCGATCGCCCCGGGCTGGTCGCCGCCGTGGG
CACCCATACCGTCCGGCTATGGGAGACCGACATCACCACCTTCGACCCGCGCATCCGCGACGCGCTGGAGGAAGAGGCGC
GGCTGGGCGCCGAATACACGGCGCTGCTGGCGTCGGCGCGCCTGACCGTGGACGGGCAGACCGTCAATCTGTCCGGACTG
GCGCCGTTCGCCGAAAGCCTGGACCGTGACGTGCGCCACGCGGCGGAACAGGCGCGGTGGGATTTCTTCGCCACCCACGG
CACGGAACTGGATGCGCTGTACGACCGGCTGGTCCAGGTCCGTCACGGCATGGCGCGGACCCTGGGCTACGACACCTATA
CCCCCCTGGGCTACCGCCGGATGCGGCGCGTCGATTACGGACCGGCCGAGGTCGCGCGCTTTCGGGACGACGTGCTGACC
CATGTGGTGCCGCTGGTGCGCGCGATCATGGAAAACCGCCGGCTGACCATGAACTGGGACCGGCTGCGGTCCTGGGACGA
GGCGCTGATCGACCCACTGGGCAACCCCCGGCCGGCGGGCGACCACGACGTGCTGGTCGAACGGGCGCAGACCATGTTCG
ACCGGATGGGCGGCGACCTGGGCGCCTTCTATCGCAAGATGACCGAGGGCGGGTTCCTGGACGTGCGCAATCGCCCGACC
AAGGCCGGAGGCGGGTTCTGCACCGCGTTTCCCAGCATGGGCATGCCGTTCATCTTCGCCAATTTCAACGGCACGCAGCA
CGACATCAACGTCTTCACCCACGAGATGGGCCACGCCTACCAGAACTGGAAGAGCCGCGACCTGCCCGGGATCGACCTGC
TGTGGCCGACCATGGAAGCCGCCGAGATCAATTCGATGGCGCTGGAATTCCTGACCTGGCCGCAGATCGACCTGATGGTC
GAGGACGGGCTGGCGGACCGGTTCCGCCGCGTGCACCTGATCGGCTCGCTCAGCTTCCTGCCCTATGGCGTCTGCGTCGA
TCATTTCCAGCATGAGGTCTATGCCCGGCCCGACATGACGGCCGAGCAGCGCCATGCGACCTGGCGGCGGCTGGAACAGC
TTTACATGCCCTGGCGGGACTATGGCGACCTGGCGCGCCCGGCCATGGGCGGGCGGTGGCAGGCCCAGGGCCACATCTAC
CGCTCGCCCTTCTATTACATCGACTACACGCTGGCCCTGTGCTGCGCGATGCAGTTCTGGCTGCGCAGCCGGACCGACCA
GGACGGCGCGATGGCGGTCTATACCGACCTGTGCACGCTGGGCGGGTCCCAGCCCTTCACCGGCCTGGTCGCCGCCGCCG
GCCTGGCCAGTCCGTTCGAACCCGGAACCCTGGCCGACATCGTGCAGGAGGCCGAACGCGTCCTGCAAATGCGGTGA

Upstream 100 bases:

>100_bases
GGCTGCGATCCTTCAGCCTCGCCGCCGAGGCATGGCGGGACCTTGCCCACGCCTAACACGACGATGGACGGGGCCGTGTC
GTCGATGCGATGATCGGAGC

Downstream 100 bases:

>100_bases
GGTAAGAGGCTGTTTTTAAAGGTAGCTGCGGCGGCCTCAGTGGTCGCGCGCGTCCCAGCCGGCCAGCAGGTCGACGACCG
CCTGGGCGGACATGCGGCGC

Product: oligoendopeptidase F

Products: NA

Alternate protein names: Oligoendopeptidase M3 Family; M3 Family Oligoendopeptidase; Oligoendopeptidase; Peptidase M3A And M3B Thimet/Oligopeptidase F; Oligopeptidase; Oligopeptidase F; Oligoendopeptidase M3 Family Protein; Truncated Oligoendopeptidase F; Peptidase M3 Family Protein; PepF/M3 Family Oligoendopeptidase; Peptidase M3 Oligoendopeptidase F; Oligoendopeptidase PepF/M3 Family; M3B Family Peptidase; Exported Peptidase

Number of amino acids: Translated: 558; Mature: 557

Protein sequence:

>558_residues
MSILFKDLAFPTPTADGLAAAFGRVTALLDAGQRDQALALFDTERRAYDSWASLVALRFAQDTTDPQARADRDLADSLTP
RVTEHEIAIKRRLLDDPDRPGLVAAVGTHTVRLWETDITTFDPRIRDALEEEARLGAEYTALLASARLTVDGQTVNLSGL
APFAESLDRDVRHAAEQARWDFFATHGTELDALYDRLVQVRHGMARTLGYDTYTPLGYRRMRRVDYGPAEVARFRDDVLT
HVVPLVRAIMENRRLTMNWDRLRSWDEALIDPLGNPRPAGDHDVLVERAQTMFDRMGGDLGAFYRKMTEGGFLDVRNRPT
KAGGGFCTAFPSMGMPFIFANFNGTQHDINVFTHEMGHAYQNWKSRDLPGIDLLWPTMEAAEINSMALEFLTWPQIDLMV
EDGLADRFRRVHLIGSLSFLPYGVCVDHFQHEVYARPDMTAEQRHATWRRLEQLYMPWRDYGDLARPAMGGRWQAQGHIY
RSPFYYIDYTLALCCAMQFWLRSRTDQDGAMAVYTDLCTLGGSQPFTGLVAAAGLASPFEPGTLADIVQEAERVLQMR

Sequences:

>Translated_558_residues
MSILFKDLAFPTPTADGLAAAFGRVTALLDAGQRDQALALFDTERRAYDSWASLVALRFAQDTTDPQARADRDLADSLTP
RVTEHEIAIKRRLLDDPDRPGLVAAVGTHTVRLWETDITTFDPRIRDALEEEARLGAEYTALLASARLTVDGQTVNLSGL
APFAESLDRDVRHAAEQARWDFFATHGTELDALYDRLVQVRHGMARTLGYDTYTPLGYRRMRRVDYGPAEVARFRDDVLT
HVVPLVRAIMENRRLTMNWDRLRSWDEALIDPLGNPRPAGDHDVLVERAQTMFDRMGGDLGAFYRKMTEGGFLDVRNRPT
KAGGGFCTAFPSMGMPFIFANFNGTQHDINVFTHEMGHAYQNWKSRDLPGIDLLWPTMEAAEINSMALEFLTWPQIDLMV
EDGLADRFRRVHLIGSLSFLPYGVCVDHFQHEVYARPDMTAEQRHATWRRLEQLYMPWRDYGDLARPAMGGRWQAQGHIY
RSPFYYIDYTLALCCAMQFWLRSRTDQDGAMAVYTDLCTLGGSQPFTGLVAAAGLASPFEPGTLADIVQEAERVLQMR
>Mature_557_residues
SILFKDLAFPTPTADGLAAAFGRVTALLDAGQRDQALALFDTERRAYDSWASLVALRFAQDTTDPQARADRDLADSLTPR
VTEHEIAIKRRLLDDPDRPGLVAAVGTHTVRLWETDITTFDPRIRDALEEEARLGAEYTALLASARLTVDGQTVNLSGLA
PFAESLDRDVRHAAEQARWDFFATHGTELDALYDRLVQVRHGMARTLGYDTYTPLGYRRMRRVDYGPAEVARFRDDVLTH
VVPLVRAIMENRRLTMNWDRLRSWDEALIDPLGNPRPAGDHDVLVERAQTMFDRMGGDLGAFYRKMTEGGFLDVRNRPTK
AGGGFCTAFPSMGMPFIFANFNGTQHDINVFTHEMGHAYQNWKSRDLPGIDLLWPTMEAAEINSMALEFLTWPQIDLMVE
DGLADRFRRVHLIGSLSFLPYGVCVDHFQHEVYARPDMTAEQRHATWRRLEQLYMPWRDYGDLARPAMGGRWQAQGHIYR
SPFYYIDYTLALCCAMQFWLRSRTDQDGAMAVYTDLCTLGGSQPFTGLVAAAGLASPFEPGTLADIVQEAERVLQMR

Specific function: Unknown

COG id: COG1164

COG function: function code E; Oligoendopeptidase F

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 63099; Mature: 62968

Theoretical pI: Translated: 5.37; Mature: 5.37

Prosite motif: PS00142 ZINC_PROTEASE

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.9 %Cys     (Translated Protein)
3.6 %Met     (Translated Protein)
4.5 %Cys+Met (Translated Protein)
0.9 %Cys     (Mature Protein)
3.4 %Met     (Mature Protein)
4.3 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSILFKDLAFPTPTADGLAAAFGRVTALLDAGQRDQALALFDTERRAYDSWASLVALRFA
CCCEEHHHCCCCCCCHHHHHHHHHHHHHHCCCCCCCEEEEEECHHHHHHHHHHHHHHHHH
QDTTDPQARADRDLADSLTPRVTEHEIAIKRRLLDDPDRPGLVAAVGTHTVRLWETDITT
CCCCCCHHHHCHHHHHHCCCCCHHHHHHHHHHHCCCCCCCCEEEEECCCEEEEEECCCCC
FDPRIRDALEEEARLGAEYTALLASARLTVDGQTVNLSGLAPFAESLDRDVRHAAEQARW
CCHHHHHHHHHHHHCCHHHHHHHHHHEEEECCCEEEECCCCHHHHHHHHHHHHHHHHHCC
DFFATHGTELDALYDRLVQVRHGMARTLGYDTYTPLGYRRMRRVDYGPAEVARFRDDVLT
CEEECCCCHHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHCCCCHHHHHHHHHHHHH
HVVPLVRAIMENRRLTMNWDRLRSWDEALIDPLGNPRPAGDHDVLVERAQTMFDRMGGDL
HHHHHHHHHHHCCCEEECHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHCCHH
GAFYRKMTEGGFLDVRNRPTKAGGGFCTAFPSMGMPFIFANFNGTQHDINVFTHEMGHAY
HHHHHHHCCCCEEECCCCCCCCCCCEEECCCCCCCCEEEECCCCCCCHHHHHHHHHHHHH
QNWKSRDLPGIDLLWPTMEAAEINSMALEFLTWPQIDLMVEDGLADRFRRVHLIGSLSFL
HCCCCCCCCCCEEECCCCHHHHHHHHHHHHHCCCCEEEEECCCHHHHHHHHHHHHCHHHH
PYGVCVDHFQHEVYARPDMTAEQRHATWRRLEQLYMPWRDYGDLARPAMGGRWQAQGHIY
HHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHCCHHHHHHHHCCCCCCCCCCCCCEE
RSPFYYIDYTLALCCAMQFWLRSRTDQDGAMAVYTDLCTLGGSQPFTGLVAAAGLASPFE
ECCCHHHHHHHHHHHHHHHHHHCCCCCCCCCHHHHHHHHCCCCCCHHHHHHHHHCCCCCC
PGTLADIVQEAERVLQMR
CCHHHHHHHHHHHHHCCC
>Mature Secondary Structure 
SILFKDLAFPTPTADGLAAAFGRVTALLDAGQRDQALALFDTERRAYDSWASLVALRFA
CCEEHHHCCCCCCCHHHHHHHHHHHHHHCCCCCCCEEEEEECHHHHHHHHHHHHHHHHH
QDTTDPQARADRDLADSLTPRVTEHEIAIKRRLLDDPDRPGLVAAVGTHTVRLWETDITT
CCCCCCHHHHCHHHHHHCCCCCHHHHHHHHHHHCCCCCCCCEEEEECCCEEEEEECCCCC
FDPRIRDALEEEARLGAEYTALLASARLTVDGQTVNLSGLAPFAESLDRDVRHAAEQARW
CCHHHHHHHHHHHHCCHHHHHHHHHHEEEECCCEEEECCCCHHHHHHHHHHHHHHHHHCC
DFFATHGTELDALYDRLVQVRHGMARTLGYDTYTPLGYRRMRRVDYGPAEVARFRDDVLT
CEEECCCCHHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHCCCCHHHHHHHHHHHHH
HVVPLVRAIMENRRLTMNWDRLRSWDEALIDPLGNPRPAGDHDVLVERAQTMFDRMGGDL
HHHHHHHHHHHCCCEEECHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHCCHH
GAFYRKMTEGGFLDVRNRPTKAGGGFCTAFPSMGMPFIFANFNGTQHDINVFTHEMGHAY
HHHHHHHCCCCEEECCCCCCCCCCCEEECCCCCCCCEEEECCCCCCCHHHHHHHHHHHHH
QNWKSRDLPGIDLLWPTMEAAEINSMALEFLTWPQIDLMVEDGLADRFRRVHLIGSLSFL
HCCCCCCCCCCEEECCCCHHHHHHHHHHHHHCCCCEEEEECCCHHHHHHHHHHHHCHHHH
PYGVCVDHFQHEVYARPDMTAEQRHATWRRLEQLYMPWRDYGDLARPAMGGRWQAQGHIY
HHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHCCHHHHHHHHCCCCCCCCCCCCCEE
RSPFYYIDYTLALCCAMQFWLRSRTDQDGAMAVYTDLCTLGGSQPFTGLVAAAGLASPFE
ECCCHHHHHHHHHHHHHHHHHHCCCCCCCCCHHHHHHHHCCCCCCHHHHHHHHHCCCCCC
PGTLADIVQEAERVLQMR
CCHHHHHHHHHHHHHCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA