Definition Geobacter sulfurreducens PCA chromosome, complete genome.
Accession NC_002939
Length 3,814,139

Click here to switch to the map view.

The map label for this gene is aprN [H]

Identifier: 39997173

GI number: 39997173

Start: 2279884

End: 2281341

Strand: Reverse

Name: aprN [H]

Synonym: GSU2075

Alternate gene names: 39997173

Gene position: 2281341-2279884 (Counterclockwise)

Preceding gene: 39997174

Following gene: 39997172

Centisome position: 59.81

GC content: 62.55

Gene sequence:

>1458_bases
ATGAGGTATCTGCTCGCCGTTACGGCTCTTTTTATCCTGCTGCCTCCTCTGGGTGACGCTTTTGCCGCCGACAGGAAGGT
CATTGTAGGATTTCGCTCCACGGTGGAAAAAAGGGACGTTCGCCACAAAGAGAAGGTCTATCGGCACGGCGGTCGCGTCA
AGAGGACGCACTCTGCGGTAAACGCCATATCGGCAACCCTGTCCGAAGAAGAGATCGAGCGCCTGAAGAAAGATCCCGAC
GTTGCCTACGTGGAGACGGACTTCGTGCTTTCGTCCATTGAACCGGCCGCGGCTTCGCCGGAGGAGTATGCCGCAGCGTG
GGGCGCGCAGCACATCGGTGCCGACCAGGTTGCGGCGGCCGGCATCACCGGCGCGGGGGTCCGGGTGGCAGTGCTCGATA
CGGGCATTGATTACACGCATCCCGATTTGAAGGACAACTACAAGGGGGGGTACAACTTTGTAGCAGACAACAACGATCCC
ATGGACGACGCATACTCCCTCAGCCATGGCACCCACGTGGCCGGGATCATCGCCGCCCGCAACAACGGTACCGGTGTGGT
CGGCGTCGCGCCCGCAGCGGAGCTCTATGCGGTCAAGGTGCTTAACGGCGGCCTCGGCGGAGAGTTGAGCGACATTATCG
CCGGCATCGAGTGGGCCATCGAGAACCGGATGCAGGTCGTCAACATGAGCTTCGGCAGCATGGAGTTCTCCCAGGCGCTC
AAGGATGTCTGCGATCTGGCCTATCGATCGGGAATCGTGCTGGTGGCTTCGGCCGGCAATTTCTCGCCGGGGGCCGTACT
CTATCCCGCCGCTTTCGATTCGGTCGTGGCGGTTTCCGCCACCTACCAGGACGACACGCTTGGAACGTTTTCCAGTTACG
GTCCCCAGGTCGAATTGGCCGCACCGGGGCACAATATCTATTCCACGGCGATCGGCGGCGGCTACCGCATCAACTTCGGC
ACATCGCAGGCCGCACCCCATGTCACCGGTGCGGCGGCGCTTCTCATCTCGGCCGGCACCACCGACACCAACGGTAACCG
CTCCGTTGCCGACGAGGTCAGGCAACGACTTGCGGCAGCCGCCCGGGACCTGGGTGAAATGGGCAGGGACATCTACTATG
GTTACGGCCTCGTTGACGTAGCCAAGGCCGTTCTGTCGCCGCCGAACATCGAGACGGTGGTCACCACGCCGCGGGGGAAA
CGGTGTGCATCTGCTGCAGCCCTTGATCTGGCGAACTCGACCTACCGGCTGGACATTACGGGAGCGACGTTGCAGGCGCT
TGAAGTCCGCGTCGGGAGCGCCGACGGGCCTCTTGTGAGCTTTATCCGCTTCCGGCGTGGGACTGAAGGGGCGGTATCGT
TCAGCTACACGGCATCCGGCACTGTCAGGCTGGTGCTGATCCCCCACGGCAAACCGGGAACATCGGCGCGGGTGACGGCC
GTTCCGGAGCAGCTGTGA

Upstream 100 bases:

>100_bases
AGGGGATTCGTTCCCCTGCCCTCCATCTCCTCCCCAGACATCATTTACATGCATTCGCGATGTGATTCACCATCGTCGAA
CGTGAAGGGATACGTGCACC

Downstream 100 bases:

>100_bases
GTCGGGCGGGCACGATGAAGACAGTACGCAACCTCATTATTACCATTCTGTGCTTGCTGGGAAGCGTTCCGTCCGCGCCC
GGCGCCGAAACGGCCGTCGC

Product: subtilisin

Products: NA

Alternate protein names: Nattokinase [H]

Number of amino acids: Translated: 485; Mature: 485

Protein sequence:

>485_residues
MRYLLAVTALFILLPPLGDAFAADRKVIVGFRSTVEKRDVRHKEKVYRHGGRVKRTHSAVNAISATLSEEEIERLKKDPD
VAYVETDFVLSSIEPAAASPEEYAAAWGAQHIGADQVAAAGITGAGVRVAVLDTGIDYTHPDLKDNYKGGYNFVADNNDP
MDDAYSLSHGTHVAGIIAARNNGTGVVGVAPAAELYAVKVLNGGLGGELSDIIAGIEWAIENRMQVVNMSFGSMEFSQAL
KDVCDLAYRSGIVLVASAGNFSPGAVLYPAAFDSVVAVSATYQDDTLGTFSSYGPQVELAAPGHNIYSTAIGGGYRINFG
TSQAAPHVTGAAALLISAGTTDTNGNRSVADEVRQRLAAAARDLGEMGRDIYYGYGLVDVAKAVLSPPNIETVVTTPRGK
RCASAAALDLANSTYRLDITGATLQALEVRVGSADGPLVSFIRFRRGTEGAVSFSYTASGTVRLVLIPHGKPGTSARVTA
VPEQL

Sequences:

>Translated_485_residues
MRYLLAVTALFILLPPLGDAFAADRKVIVGFRSTVEKRDVRHKEKVYRHGGRVKRTHSAVNAISATLSEEEIERLKKDPD
VAYVETDFVLSSIEPAAASPEEYAAAWGAQHIGADQVAAAGITGAGVRVAVLDTGIDYTHPDLKDNYKGGYNFVADNNDP
MDDAYSLSHGTHVAGIIAARNNGTGVVGVAPAAELYAVKVLNGGLGGELSDIIAGIEWAIENRMQVVNMSFGSMEFSQAL
KDVCDLAYRSGIVLVASAGNFSPGAVLYPAAFDSVVAVSATYQDDTLGTFSSYGPQVELAAPGHNIYSTAIGGGYRINFG
TSQAAPHVTGAAALLISAGTTDTNGNRSVADEVRQRLAAAARDLGEMGRDIYYGYGLVDVAKAVLSPPNIETVVTTPRGK
RCASAAALDLANSTYRLDITGATLQALEVRVGSADGPLVSFIRFRRGTEGAVSFSYTASGTVRLVLIPHGKPGTSARVTA
VPEQL
>Mature_485_residues
MRYLLAVTALFILLPPLGDAFAADRKVIVGFRSTVEKRDVRHKEKVYRHGGRVKRTHSAVNAISATLSEEEIERLKKDPD
VAYVETDFVLSSIEPAAASPEEYAAAWGAQHIGADQVAAAGITGAGVRVAVLDTGIDYTHPDLKDNYKGGYNFVADNNDP
MDDAYSLSHGTHVAGIIAARNNGTGVVGVAPAAELYAVKVLNGGLGGELSDIIAGIEWAIENRMQVVNMSFGSMEFSQAL
KDVCDLAYRSGIVLVASAGNFSPGAVLYPAAFDSVVAVSATYQDDTLGTFSSYGPQVELAAPGHNIYSTAIGGGYRINFG
TSQAAPHVTGAAALLISAGTTDTNGNRSVADEVRQRLAAAARDLGEMGRDIYYGYGLVDVAKAVLSPPNIETVVTTPRGK
RCASAAALDLANSTYRLDITGATLQALEVRVGSADGPLVSFIRFRRGTEGAVSFSYTASGTVRLVLIPHGKPGTSARVTA
VPEQL

Specific function: Subtilisin is an extracellular alkaline serine protease, it catalyzes the hydrolysis of proteins and peptide amides. Subtilisin NAT also has fibrinolytic activity [H]

COG id: COG1404

COG function: function code O; Subtilisin-like serine proteases

Gene ontology:

Cell location: Secreted [H]

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Belongs to the peptidase S8 family [H]

Homologues:

Organism=Homo sapiens, GI4506775, Length=326, Percent_Identity=29.7546012269939, Blast_Score=99, Evalue=8e-21,
Organism=Homo sapiens, GI31317307, Length=332, Percent_Identity=31.0240963855422, Blast_Score=89, Evalue=1e-17,
Organism=Homo sapiens, GI4505579, Length=473, Percent_Identity=26.0042283298097, Blast_Score=70, Evalue=4e-12,
Organism=Caenorhabditis elegans, GI71987206, Length=420, Percent_Identity=23.3333333333333, Blast_Score=71, Evalue=1e-12,
Organism=Saccharomyces cerevisiae, GI6324576, Length=345, Percent_Identity=29.8550724637681, Blast_Score=104, Evalue=4e-23,
Organism=Saccharomyces cerevisiae, GI6319893, Length=235, Percent_Identity=33.6170212765957, Blast_Score=98, Evalue=2e-21,
Organism=Saccharomyces cerevisiae, GI6320775, Length=295, Percent_Identity=30.8474576271186, Blast_Score=98, Evalue=4e-21,
Organism=Drosophila melanogaster, GI45550681, Length=242, Percent_Identity=32.2314049586777, Blast_Score=99, Evalue=9e-21,
Organism=Drosophila melanogaster, GI24650056, Length=326, Percent_Identity=27.3006134969325, Blast_Score=69, Evalue=7e-12,
Organism=Drosophila melanogaster, GI24650058, Length=326, Percent_Identity=27.3006134969325, Blast_Score=69, Evalue=8e-12,
Organism=Drosophila melanogaster, GI24650060, Length=326, Percent_Identity=27.3006134969325, Blast_Score=69, Evalue=8e-12,
Organism=Drosophila melanogaster, GI45553513, Length=326, Percent_Identity=27.3006134969325, Blast_Score=69, Evalue=8e-12,
Organism=Drosophila melanogaster, GI17136192, Length=122, Percent_Identity=36.0655737704918, Blast_Score=69, Evalue=1e-11,
Organism=Drosophila melanogaster, GI45553515, Length=326, Percent_Identity=27.3006134969325, Blast_Score=69, Evalue=1e-11,
Organism=Drosophila melanogaster, GI17864552, Length=326, Percent_Identity=27.3006134969325, Blast_Score=68, Evalue=1e-11,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR000209
- InterPro:   IPR022398
- InterPro:   IPR015500
- InterPro:   IPR009020
- InterPro:   IPR010259 [H]

Pfam domain/function: PF05922 Inhibitor_I9; PF00082 Peptidase_S8 [H]

EC number: =3.4.21.62 [H]

Molecular weight: Translated: 50928; Mature: 50928

Theoretical pI: Translated: 5.83; Mature: 5.83

Prosite motif: PS00136 SUBTILASE_ASP ; PS00137 SUBTILASE_HIS ; PS00138 SUBTILASE_SER

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.4 %Cys     (Translated Protein)
1.2 %Met     (Translated Protein)
1.6 %Cys+Met (Translated Protein)
0.4 %Cys     (Mature Protein)
1.2 %Met     (Mature Protein)
1.6 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MRYLLAVTALFILLPPLGDAFAADRKVIVGFRSTVEKRDVRHKEKVYRHGGRVKRTHSAV
CHHHHHHHHHHHHHCCCCCCHHCCCEEEEEHHHHHHHHHHHHHHHHHHCCCCEEHHHHHH
NAISATLSEEEIERLKKDPDVAYVETDFVLSSIEPAAASPEEYAAAWGAQHIGADQVAAA
HHHHHHCCHHHHHHHHCCCCEEEEEHHHHHCCCCCCCCCCHHHHHHHCCCCCCHHHHHHC
GITGAGVRVAVLDTGIDYTHPDLKDNYKGGYNFVADNNDPMDDAYSLSHGTHVAGIIAAR
CCCCCCEEEEEEECCCCCCCCCCCCCCCCCEEEEECCCCCCCHHHHCCCCCEEEEEEEEC
NNGTGVVGVAPAAELYAVKVLNGGLGGELSDIIAGIEWAIENRMQVVNMSFGSMEFSQAL
CCCCEEEEECCCCCEEEEEEECCCCCCHHHHHHHHHHHHHHCCEEEEEECCCCHHHHHHH
KDVCDLAYRSGIVLVASAGNFSPGAVLYPAAFDSVVAVSATYQDDTLGTFSSYGPQVELA
HHHHHHHHHCCEEEEEECCCCCCCCEEECCCCCCEEEEEEECCCCCCCCHHCCCCEEEEE
APGHNIYSTAIGGGYRINFGTSQAAPHVTGAAALLISAGTTDTNGNRSVADEVRQRLAAA
CCCCCEEEEECCCCEEEECCCCCCCCCCCCCEEEEEECCCCCCCCCCHHHHHHHHHHHHH
ARDLGEMGRDIYYGYGLVDVAKAVLSPPNIETVVTTPRGKRCASAAALDLANSTYRLDIT
HHHHHHHCCCEEECCCHHHHHHHHCCCCCCEEEEECCCCCHHHHHHHHHCCCCEEEEEEC
GATLQALEVRVGSADGPLVSFIRFRRGTEGAVSFSYTASGTVRLVLIPHGKPGTSARVTA
CCEEEEEEEEECCCCCHHHHHHHHHCCCCCCEEEEEECCCEEEEEEEECCCCCCCCEEEE
VPEQL
CCCCC
>Mature Secondary Structure
MRYLLAVTALFILLPPLGDAFAADRKVIVGFRSTVEKRDVRHKEKVYRHGGRVKRTHSAV
CHHHHHHHHHHHHHCCCCCCHHCCCEEEEEHHHHHHHHHHHHHHHHHHCCCCEEHHHHHH
NAISATLSEEEIERLKKDPDVAYVETDFVLSSIEPAAASPEEYAAAWGAQHIGADQVAAA
HHHHHHCCHHHHHHHHCCCCEEEEEHHHHHCCCCCCCCCCHHHHHHHCCCCCCHHHHHHC
GITGAGVRVAVLDTGIDYTHPDLKDNYKGGYNFVADNNDPMDDAYSLSHGTHVAGIIAAR
CCCCCCEEEEEEECCCCCCCCCCCCCCCCCEEEEECCCCCCCHHHHCCCCCEEEEEEEEC
NNGTGVVGVAPAAELYAVKVLNGGLGGELSDIIAGIEWAIENRMQVVNMSFGSMEFSQAL
CCCCEEEEECCCCCEEEEEEECCCCCCHHHHHHHHHHHHHHCCEEEEEECCCCHHHHHHH
KDVCDLAYRSGIVLVASAGNFSPGAVLYPAAFDSVVAVSATYQDDTLGTFSSYGPQVELA
HHHHHHHHHCCEEEEEECCCCCCCCEEECCCCCCEEEEEEECCCCCCCCHHCCCCEEEEE
APGHNIYSTAIGGGYRINFGTSQAAPHVTGAAALLISAGTTDTNGNRSVADEVRQRLAAA
CCCCCEEEEECCCCEEEECCCCCCCCCCCCCEEEEEECCCCCCCCCCHHHHHHHHHHHHH
ARDLGEMGRDIYYGYGLVDVAKAVLSPPNIETVVTTPRGKRCASAAALDLANSTYRLDIT
HHHHHHHCCCEEECCCHHHHHHHHCCCCCCEEEEECCCCCHHHHHHHHHCCCCEEEEEEC
GATLQALEVRVGSADGPLVSFIRFRRGTEGAVSFSYTASGTVRLVLIPHGKPGTSARVTA
CCEEEEEEEEECCCCCHHHHHHHHHCCCCCCEEEEEECCCEEEEEEEECCCCCCCCEEEE
VPEQL
CCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 1369081 [H]