Definition Mycobacterium avium subsp. paratuberculosis K-10, complete genome.
Accession NC_002944
Length 4,829,781

Click here to switch to the map view.

The map label for this gene is pepQ

Identifier: 41407194

GI number: 41407194

Start: 1148581

End: 1149690

Strand: Direct

Name: pepQ

Synonym: MAP1096

Alternate gene names: 41407194

Gene position: 1148581-1149690 (Clockwise)

Preceding gene: 41407192

Following gene: 41407195

Centisome position: 23.78

GC content: 73.51

Gene sequence:

>1110_bases
GTGACACATTCTCAACGCCGGGACCGGCTCAGGGCACGACTCGAGGCCGACGGACTGGATGCGCTGCTGGTCACGGACCT
GATCAACGTCCGCTACCTGTCCGGATTCACCGGCTCCAACGGCGCGTTGCTGGTGTTCGCCGACGACCGGCCCCCGGTGC
TGGCGACCGACGGCCGGTACCGGACCCAGGCCGCCGAGCAGGCCCCCGACCTCGACGTCGCCATCGAACGCGCGCTGGGC
CGCTATCTGGCCGGCCGCGCCGCCGAGGCGGGCGCACGCACCCTGGGCTTCGAGAGCAACGTGGTCACCGTCGACGGATT
CGACGCCCTGACGGGTGAGCTGGACGGCCGCAAGGCAGCCACCGAGCTGGTCAAGGCCGCCGGCACCGTCGAGGCGTTGC
GCGAGGTCAAGGACGCCGGCGAGGTCGCGCTGCTGCGGCTGGCCTGCGAGGCGGCCGACGCCGCGCTCACCGCGCTGGTG
GACGGCGGCGGGCTGCGGCCCGGCCGCACCGAACGCGAGGTCAGCCGGGAGCTGGAGGCGCTGATGCTCGACCACGGCGC
CGACGGGATCTCCTTCGAGACCATCGTGGCGACCGGCGCCAACTCGGCGATCCCGCATCACCGCCCCACCGACGCGGTGC
TGGCCGACGGCGACTTCGTCAAGATCGACTTCGGGGCGCTGGTCGGCGGCTACCACTCCGACATGACCCGCACCTTCGTG
CTGACCAAGGCGGCCGACTGGCAGCTGGAGATCTACCGGCTGGTCGCCGACGCGCAGCGGGCCGGCCGGGAGGCGCTGCG
GGCCGGCGCCGACCTTCGCGAGGTGGACGCCGCGGCCCGCCGGGTGATCGCCGACGCCGGCTACGGCGAGCAGTTCAGCC
ACAGCCTGGGCCACGGCGTCGGGTTGGAGATCCACGAGGCGCCGGGCATCGGCGCCACCTCCACCGGCACGCTGCGCGCC
GAATCGGTGGTGACCGTGGAGCCCGGCGTCTATCTGCCCGGCCGCGGCGGCGTGCGCATCGAGGACACGTTGGTGGTGCC
GCCGGAGACCGCCGGCAAGCCCCCGGAGCTGCTGACCAGGTTCCCCAAGGAGCTGGCCGTCCTGGCCTGA

Upstream 100 bases:

>100_bases
CCTGGAACAATCGGACGACGACCATCGCCGCGGCGTACACCAATCCGCGCAGCATCCAGTTACTCATGGCCCAAAAGCGT
AGCGAGTACCGTCAAGACCC

Downstream 100 bases:

>100_bases
CGCCCGCCGGCGCCCTCTAAACTGGCCGACAAGTCCCACGACGGCCGCACCGCCGGCCGTCCATCCCCGAGGAGATATAG
GCGCACCGTGGCAAGCACTG

Product: PepQ

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 369; Mature: 368

Protein sequence:

>369_residues
MTHSQRRDRLRARLEADGLDALLVTDLINVRYLSGFTGSNGALLVFADDRPPVLATDGRYRTQAAEQAPDLDVAIERALG
RYLAGRAAEAGARTLGFESNVVTVDGFDALTGELDGRKAATELVKAAGTVEALREVKDAGEVALLRLACEAADAALTALV
DGGGLRPGRTEREVSRELEALMLDHGADGISFETIVATGANSAIPHHRPTDAVLADGDFVKIDFGALVGGYHSDMTRTFV
LTKAADWQLEIYRLVADAQRAGREALRAGADLREVDAAARRVIADAGYGEQFSHSLGHGVGLEIHEAPGIGATSTGTLRA
ESVVTVEPGVYLPGRGGVRIEDTLVVPPETAGKPPELLTRFPKELAVLA

Sequences:

>Translated_369_residues
MTHSQRRDRLRARLEADGLDALLVTDLINVRYLSGFTGSNGALLVFADDRPPVLATDGRYRTQAAEQAPDLDVAIERALG
RYLAGRAAEAGARTLGFESNVVTVDGFDALTGELDGRKAATELVKAAGTVEALREVKDAGEVALLRLACEAADAALTALV
DGGGLRPGRTEREVSRELEALMLDHGADGISFETIVATGANSAIPHHRPTDAVLADGDFVKIDFGALVGGYHSDMTRTFV
LTKAADWQLEIYRLVADAQRAGREALRAGADLREVDAAARRVIADAGYGEQFSHSLGHGVGLEIHEAPGIGATSTGTLRA
ESVVTVEPGVYLPGRGGVRIEDTLVVPPETAGKPPELLTRFPKELAVLA
>Mature_368_residues
THSQRRDRLRARLEADGLDALLVTDLINVRYLSGFTGSNGALLVFADDRPPVLATDGRYRTQAAEQAPDLDVAIERALGR
YLAGRAAEAGARTLGFESNVVTVDGFDALTGELDGRKAATELVKAAGTVEALREVKDAGEVALLRLACEAADAALTALVD
GGGLRPGRTEREVSRELEALMLDHGADGISFETIVATGANSAIPHHRPTDAVLADGDFVKIDFGALVGGYHSDMTRTFVL
TKAADWQLEIYRLVADAQRAGREALRAGADLREVDAAARRVIADAGYGEQFSHSLGHGVGLEIHEAPGIGATSTGTLRAE
SVVTVEPGVYLPGRGGVRIEDTLVVPPETAGKPPELLTRFPKELAVLA

Specific function: Unknown

COG id: COG0006

COG function: function code E; Xaa-Pro aminopeptidase

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the peptidase M24B family [H]

Homologues:

Organism=Homo sapiens, GI93141226, Length=183, Percent_Identity=33.3333333333333, Blast_Score=79, Evalue=6e-15,
Organism=Homo sapiens, GI11559925, Length=266, Percent_Identity=25.9398496240602, Blast_Score=73, Evalue=4e-13,
Organism=Homo sapiens, GI264681563, Length=240, Percent_Identity=33.3333333333333, Blast_Score=71, Evalue=2e-12,
Organism=Escherichia coli, GI1788728, Length=362, Percent_Identity=37.292817679558, Blast_Score=210, Evalue=1e-55,
Organism=Escherichia coli, GI1789275, Length=256, Percent_Identity=30.859375, Blast_Score=101, Evalue=6e-23,
Organism=Caenorhabditis elegans, GI17508215, Length=278, Percent_Identity=25.8992805755396, Blast_Score=75, Evalue=6e-14,
Organism=Caenorhabditis elegans, GI17509539, Length=376, Percent_Identity=25.531914893617, Blast_Score=69, Evalue=3e-12,
Organism=Saccharomyces cerevisiae, GI6320922, Length=241, Percent_Identity=24.0663900414938, Blast_Score=88, Evalue=2e-18,
Organism=Saccharomyces cerevisiae, GI6322999, Length=172, Percent_Identity=32.5581395348837, Blast_Score=74, Evalue=4e-14,
Organism=Drosophila melanogaster, GI19920384, Length=261, Percent_Identity=25.6704980842912, Blast_Score=79, Evalue=3e-15,
Organism=Drosophila melanogaster, GI21357079, Length=258, Percent_Identity=28.6821705426357, Blast_Score=76, Evalue=3e-14,
Organism=Drosophila melanogaster, GI17137632, Length=168, Percent_Identity=30.3571428571429, Blast_Score=66, Evalue=4e-11,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR000587
- InterPro:   IPR001714
- InterPro:   IPR000994
- InterPro:   IPR001131 [H]

Pfam domain/function: PF01321 Creatinase_N; PF00557 Peptidase_M24 [H]

EC number: 3.4.-.- [C]

Molecular weight: Translated: 38976; Mature: 38845

Theoretical pI: Translated: 4.78; Mature: 4.78

Prosite motif: PS00491 PROLINE_PEPTIDASE

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.3 %Cys     (Translated Protein)
0.8 %Met     (Translated Protein)
1.1 %Cys+Met (Translated Protein)
0.3 %Cys     (Mature Protein)
0.5 %Met     (Mature Protein)
0.8 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MTHSQRRDRLRARLEADGLDALLVTDLINVRYLSGFTGSNGALLVFADDRPPVLATDGRY
CCCHHHHHHHHHHHCCCCCCHHHHHHHHHHHEECCEECCCCEEEEEECCCCCEEECCCCH
RTQAAEQAPDLDVAIERALGRYLAGRAAEAGARTLGFESNVVTVDGFDALTGELDGRKAA
HHHHHHHCCCHHHHHHHHHHHHHHCCCHHCCCCEECCCCCEEEECCCHHHCCCCCCHHHH
TELVKAAGTVEALREVKDAGEVALLRLACEAADAALTALVDGGGLRPGRTEREVSRELEA
HHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHEEEECCCCCCCCCCHHHHHHHHHH
LMLDHGADGISFETIVATGANSAIPHHRPTDAVLADGDFVKIDFGALVGGYHSDMTRTFV
HHHHCCCCCCEEEEEEEECCCCCCCCCCCCCCEEECCCEEEEEHHHHHCCHHHCCEEEEE
LTKAADWQLEIYRLVADAQRAGREALRAGADLREVDAAARRVIADAGYGEQFSHSLGHGV
EEECCCCHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHCCCCCHHHHHHHCCCC
GLEIHEAPGIGATSTGTLRAESVVTVEPGVYLPGRGGVRIEDTLVVPPETAGKPPELLTR
CEEEECCCCCCCCCCCCEEECEEEEECCCEEECCCCCCEEEEEEEECCCCCCCCHHHHHH
FPKELAVLA
CCHHHHHCC
>Mature Secondary Structure 
THSQRRDRLRARLEADGLDALLVTDLINVRYLSGFTGSNGALLVFADDRPPVLATDGRY
CCHHHHHHHHHHHCCCCCCHHHHHHHHHHHEECCEECCCCEEEEEECCCCCEEECCCCH
RTQAAEQAPDLDVAIERALGRYLAGRAAEAGARTLGFESNVVTVDGFDALTGELDGRKAA
HHHHHHHCCCHHHHHHHHHHHHHHCCCHHCCCCEECCCCCEEEECCCHHHCCCCCCHHHH
TELVKAAGTVEALREVKDAGEVALLRLACEAADAALTALVDGGGLRPGRTEREVSRELEA
HHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHEEEECCCCCCCCCCHHHHHHHHHH
LMLDHGADGISFETIVATGANSAIPHHRPTDAVLADGDFVKIDFGALVGGYHSDMTRTFV
HHHHCCCCCCEEEEEEEECCCCCCCCCCCCCCEEECCCEEEEEHHHHHCCHHHCCEEEEE
LTKAADWQLEIYRLVADAQRAGREALRAGADLREVDAAARRVIADAGYGEQFSHSLGHGV
EEECCCCHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHCCCCCHHHHHHHCCCC
GLEIHEAPGIGATSTGTLRAESVVTVEPGVYLPGRGGVRIEDTLVVPPETAGKPPELLTR
CEEEECCCCCCCCCCCCEEECEEEEECCCEEECCCCCCEEEEEEEECCCCCCCCHHHHHH
FPKELAVLA
CCHHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: 8969508; 9384377 [H]