Definition Nitrosospira multiformis ATCC 25196 chromosome, complete genome.
Accession NC_007614
Length 3,184,243

Click here to switch to the map view.

The map label for this gene is 82703012

Identifier: 82703012

GI number: 82703012

Start: 2177846

End: 2179726

Strand: Reverse

Name: 82703012

Synonym: Nmul_A1891

Alternate gene names: NA

Gene position: 2179726-2177846 (Counterclockwise)

Preceding gene: 82703013

Following gene: 82703011

Centisome position: 68.45

GC content: 59.6

Gene sequence:

>1881_bases
ATGAACGCCGACAAGAGGGAAGAGCAGGCCGGTGTAGCGGCCCGGCTTGCCGAGAGGTTCATATCAAACATACGCGCAAA
GGTTGCCTCATCCAGCTGCCGTTTTGCAGGGGCGATACTGGCAGTTTTGCTGGGATTGGGTCCGGTCATTTCCAGTGCAG
AGCCTCCGGAGGGCAGGGGGCCTGGAATGAACAAGCCGGTTGGCTGGGCGAAGGGTCGCATCCTGGTCATGCCGCGTGCC
GGCTTGCCGGAAAAGGAACTGGCCAAGGTTCTGGGCGAACATGGCGGCAAGGGCAGGAAGATCGGGCAGAGCGATCTGTA
TATCGTCGACTTGCCGGGTAATGCCTCCGAGAAGGCGGTGGCGGCAAGGCTTGCGCATCATCCGGCGCTCAAGTTTGCCG
AGATCGACCAGGAAGTCGAACCCGCGCTCATTCCGAACGATCCCTACTATGGCAGCGCCTGGCATTTGCCCAAGATTGGC
GCTCCGTCCGCCTGGGACAGTTCCCTGGGCAGCGGCGTGACCATCGCCATCCTGGATTCAGGAGTCGATAGCACTCACCC
TGATCTGGCTACGGAACTGGTGCCAGGCTGGAATTTCTACGAGAACAATTCCAATACATCGGATGTTTACGGGCATGGCA
CCAAGGTTGCGGGTGCGGCGGGAGCGGCAGGCAATAACGCGCTGGGGGTGGCCTCGGTGGCGGCACGGGCGAAGATCATG
CCGATCCGGGTAAGTGGCTCTGATGGGTATGCCACCTGGAGTGCGATTTCCCAAGGGCTTATCTATGCGGCAGACCGCGG
GGTTCGCGTCGCCAATGCCAGCTTTCTCGGACTGACCGACAGTGCGAGTACTCGCAGTGCGGCGCAATACCTGAAGAACA
AAGGCGGCCTTGTCATTGTCAGCGGGGGCAACACTGGCGTACAGCAAAATTATGCCGCAACCACCAGCATGATTCCTGTC
TCTGCCACTGACGGAAATGACGTACGGACGAGCTGGTCTAGTTATGGTAATTACATTGCTCTCGCGGCTCCCGGTGCAGG
AATCTGGAGCACTACCAAGGGTGGCGGCTATGGCGCGGTTTCCGGCACGTCGTTCTCAAGCCCGGTAACGGCTGGGGTGG
TGGCGCTCATGATGGCGGCAAAGCCGACATTATCCAATACCCAGATCGAGAGTCTGCTGTATTCCACGGCGGTGGATCTT
GGAACGCCAGGGCGCGATCCTTACTACGGCTATGGGCGAGTGAATGCGGCGCGTGCCGTACAGGCCGCCGCCGGCACCAC
GCTGACAGCAGATACGCAGGCTCCGGCGGTTTCCATCACTTCCCCTGCTGGCGGATCAAGCGTAACAGGCCTGGTCGGCG
TAAACGTGGCTGCGAGCGATAACGTCGGCGTGACTCGTGTCGAGTTGCGGGTCAACAATACCACAGTCGCAGTCGACACC
ACGGCGCCGTTCGCCTTCACCTGGGATTCGGCAGGCGTAGCCAACGGTATGGCGAACCTGACCGCTTATGCATTCGATGC
GGCCGGCAACTCCAAGGCTTCGACCACCGTCTCGGTGAATGTGGCAAACGGAACGACAACGGTGGCCAGGGATACTACCG
CGCCACAGGTGAAGATCGTAAATCCGGTCACAGGCAATGTTTCGGGCAGCAATGTGGCCATCAGCGTGAATGCAAGCGAT
GATAGCGGCGCTTCCGGAATCACCTGTACGCTCTACATCGACGGCGTGCTCAAGGCTACCGGAAAAGGAAGTACGTTAGG
ATATAGCTGGAATACCCGCCCAAGCAATGTGCGCGCGGGAGCACACACTATCTGGACGGTCGCCAGAGATGCGGCGGGCA
ATACAGCATCTGCTTCGGTGAATGTGACAGTGATCAAGTAA

Upstream 100 bases:

>100_bases
TCTATGGAAAGGCGCAGTGACGTGTCATGAACGTAACGACCGGCAGATTTATTGCTGTTTTTTTGGAACTTGATTTTTCA
CAATTAGAAAGGAGTCGAAC

Downstream 100 bases:

>100_bases
CCGATAGAAGCAGTAGCAAGGAGCATGTTATTACCCGTTCACATGTCGTAAATTTTTACACCCCTTCCGGGAAGATGGAA
GAAACTCGAGGTTTTTCATA

Product: peptidase S8/S53 subtilisin kexin sedolisin

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 626; Mature: 626

Protein sequence:

>626_residues
MNADKREEQAGVAARLAERFISNIRAKVASSSCRFAGAILAVLLGLGPVISSAEPPEGRGPGMNKPVGWAKGRILVMPRA
GLPEKELAKVLGEHGGKGRKIGQSDLYIVDLPGNASEKAVAARLAHHPALKFAEIDQEVEPALIPNDPYYGSAWHLPKIG
APSAWDSSLGSGVTIAILDSGVDSTHPDLATELVPGWNFYENNSNTSDVYGHGTKVAGAAGAAGNNALGVASVAARAKIM
PIRVSGSDGYATWSAISQGLIYAADRGVRVANASFLGLTDSASTRSAAQYLKNKGGLVIVSGGNTGVQQNYAATTSMIPV
SATDGNDVRTSWSSYGNYIALAAPGAGIWSTTKGGGYGAVSGTSFSSPVTAGVVALMMAAKPTLSNTQIESLLYSTAVDL
GTPGRDPYYGYGRVNAARAVQAAAGTTLTADTQAPAVSITSPAGGSSVTGLVGVNVAASDNVGVTRVELRVNNTTVAVDT
TAPFAFTWDSAGVANGMANLTAYAFDAAGNSKASTTVSVNVANGTTTVARDTTAPQVKIVNPVTGNVSGSNVAISVNASD
DSGASGITCTLYIDGVLKATGKGSTLGYSWNTRPSNVRAGAHTIWTVARDAAGNTASASVNVTVIK

Sequences:

>Translated_626_residues
MNADKREEQAGVAARLAERFISNIRAKVASSSCRFAGAILAVLLGLGPVISSAEPPEGRGPGMNKPVGWAKGRILVMPRA
GLPEKELAKVLGEHGGKGRKIGQSDLYIVDLPGNASEKAVAARLAHHPALKFAEIDQEVEPALIPNDPYYGSAWHLPKIG
APSAWDSSLGSGVTIAILDSGVDSTHPDLATELVPGWNFYENNSNTSDVYGHGTKVAGAAGAAGNNALGVASVAARAKIM
PIRVSGSDGYATWSAISQGLIYAADRGVRVANASFLGLTDSASTRSAAQYLKNKGGLVIVSGGNTGVQQNYAATTSMIPV
SATDGNDVRTSWSSYGNYIALAAPGAGIWSTTKGGGYGAVSGTSFSSPVTAGVVALMMAAKPTLSNTQIESLLYSTAVDL
GTPGRDPYYGYGRVNAARAVQAAAGTTLTADTQAPAVSITSPAGGSSVTGLVGVNVAASDNVGVTRVELRVNNTTVAVDT
TAPFAFTWDSAGVANGMANLTAYAFDAAGNSKASTTVSVNVANGTTTVARDTTAPQVKIVNPVTGNVSGSNVAISVNASD
DSGASGITCTLYIDGVLKATGKGSTLGYSWNTRPSNVRAGAHTIWTVARDAAGNTASASVNVTVIK
>Mature_626_residues
MNADKREEQAGVAARLAERFISNIRAKVASSSCRFAGAILAVLLGLGPVISSAEPPEGRGPGMNKPVGWAKGRILVMPRA
GLPEKELAKVLGEHGGKGRKIGQSDLYIVDLPGNASEKAVAARLAHHPALKFAEIDQEVEPALIPNDPYYGSAWHLPKIG
APSAWDSSLGSGVTIAILDSGVDSTHPDLATELVPGWNFYENNSNTSDVYGHGTKVAGAAGAAGNNALGVASVAARAKIM
PIRVSGSDGYATWSAISQGLIYAADRGVRVANASFLGLTDSASTRSAAQYLKNKGGLVIVSGGNTGVQQNYAATTSMIPV
SATDGNDVRTSWSSYGNYIALAAPGAGIWSTTKGGGYGAVSGTSFSSPVTAGVVALMMAAKPTLSNTQIESLLYSTAVDL
GTPGRDPYYGYGRVNAARAVQAAAGTTLTADTQAPAVSITSPAGGSSVTGLVGVNVAASDNVGVTRVELRVNNTTVAVDT
TAPFAFTWDSAGVANGMANLTAYAFDAAGNSKASTTVSVNVANGTTTVARDTTAPQVKIVNPVTGNVSGSNVAISVNASD
DSGASGITCTLYIDGVLKATGKGSTLGYSWNTRPSNVRAGAHTIWTVARDAAGNTASASVNVTVIK

Specific function: Unknown

COG id: COG1404

COG function: function code O; Subtilisin-like serine proteases

Gene ontology:

Cell location: Secreted [H]

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Belongs to the peptidase S8 family [H]

Homologues:

Organism=Homo sapiens, GI76443679, Length=349, Percent_Identity=26.3610315186246, Blast_Score=74, Evalue=6e-13,
Organism=Homo sapiens, GI20336180, Length=363, Percent_Identity=25.068870523416, Blast_Score=67, Evalue=4e-11,
Organism=Homo sapiens, GI4505577, Length=363, Percent_Identity=25.068870523416, Blast_Score=67, Evalue=4e-11,
Organism=Homo sapiens, GI20336184, Length=363, Percent_Identity=25.068870523416, Blast_Score=67, Evalue=5e-11,
Organism=Homo sapiens, GI20336182, Length=363, Percent_Identity=25.068870523416, Blast_Score=67, Evalue=6e-11,
Organism=Homo sapiens, GI20336190, Length=363, Percent_Identity=25.068870523416, Blast_Score=67, Evalue=6e-11,
Organism=Homo sapiens, GI20336188, Length=363, Percent_Identity=25.068870523416, Blast_Score=67, Evalue=6e-11,
Organism=Homo sapiens, GI27894285, Length=363, Percent_Identity=25.068870523416, Blast_Score=67, Evalue=7e-11,
Organism=Caenorhabditis elegans, GI71988312, Length=309, Percent_Identity=29.4498381877023, Blast_Score=69, Evalue=5e-12,
Organism=Caenorhabditis elegans, GI71988308, Length=309, Percent_Identity=29.4498381877023, Blast_Score=69, Evalue=6e-12,
Organism=Caenorhabditis elegans, GI71988315, Length=309, Percent_Identity=29.4498381877023, Blast_Score=69, Evalue=6e-12,
Organism=Caenorhabditis elegans, GI25141268, Length=361, Percent_Identity=26.3157894736842, Blast_Score=69, Evalue=7e-12,
Organism=Caenorhabditis elegans, GI71983555, Length=298, Percent_Identity=27.8523489932886, Blast_Score=69, Evalue=7e-12,
Organism=Caenorhabditis elegans, GI71988297, Length=309, Percent_Identity=29.4498381877023, Blast_Score=69, Evalue=9e-12,
Organism=Caenorhabditis elegans, GI71988321, Length=309, Percent_Identity=29.4498381877023, Blast_Score=69, Evalue=9e-12,
Organism=Caenorhabditis elegans, GI71988301, Length=309, Percent_Identity=29.4498381877023, Blast_Score=69, Evalue=1e-11,
Organism=Saccharomyces cerevisiae, GI6324091, Length=339, Percent_Identity=27.4336283185841, Blast_Score=77, Evalue=9e-15,
Organism=Saccharomyces cerevisiae, GI6324576, Length=291, Percent_Identity=26.8041237113402, Blast_Score=72, Evalue=2e-13,
Organism=Saccharomyces cerevisiae, GI6319893, Length=240, Percent_Identity=27.0833333333333, Blast_Score=66, Evalue=2e-11,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR000209
- InterPro:   IPR022398
- InterPro:   IPR015500 [H]

Pfam domain/function: PF00082 Peptidase_S8 [H]

EC number: =3.4.21.66 [H]

Molecular weight: Translated: 63481; Mature: 63481

Theoretical pI: Translated: 9.01; Mature: 9.01

Prosite motif: PS00584 PFKB_KINASES_2 ; PS00136 SUBTILASE_ASP ; PS00137 SUBTILASE_HIS ; PS00138 SUBTILASE_SER

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.3 %Cys     (Translated Protein)
1.3 %Met     (Translated Protein)
1.6 %Cys+Met (Translated Protein)
0.3 %Cys     (Mature Protein)
1.3 %Met     (Mature Protein)
1.6 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MNADKREEQAGVAARLAERFISNIRAKVASSSCRFAGAILAVLLGLGPVISSAEPPEGRG
CCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHCCHHHCCCCCCCCCC
PGMNKPVGWAKGRILVMPRAGLPEKELAKVLGEHGGKGRKIGQSDLYIVDLPGNASEKAV
CCCCCCCCCCCCEEEEEECCCCCHHHHHHHHHHCCCCCCEECCCCEEEEECCCCCCHHHH
AARLAHHPALKFAEIDQEVEPALIPNDPYYGSAWHLPKIGAPSAWDSSLGSGVTIAILDS
HHHHHHCCCCCHHHCCCCCCCCCCCCCCCCCCEECCCCCCCCCCCCHHCCCCEEEEEEEC
GVDSTHPDLATELVPGWNFYENNSNTSDVYGHGTKVAGAAGAAGNNALGVASVAARAKIM
CCCCCCCCHHHHHCCCCCEECCCCCCCCEECCCCEECCCCCCCCCCCCCHHHHHHCEEEE
PIRVSGSDGYATWSAISQGLIYAADRGVRVANASFLGLTDSASTRSAAQYLKNKGGLVIV
EEEEECCCCCEEHHHHHCCEEEEECCCEEEECCEEEEECCCCCHHHHHHHHHCCCCEEEE
SGGNTGVQQNYAATTSMIPVSATDGNDVRTSWSSYGNYIALAAPGAGIWSTTKGGGYGAV
ECCCCCCCCCCEEEEEEEEEECCCCCCCCCCHHHCCCEEEEECCCCCCCCCCCCCCEEEC
SGTSFSSPVTAGVVALMMAAKPTLSNTQIESLLYSTAVDLGTPGRDPYYGYGRVNAARAV
CCCCCCCCHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHCCCCCCCCCCCCCCCCHHHHH
QAAAGTTLTADTQAPAVSITSPAGGSSVTGLVGVNVAASDNVGVTRVELRVNNTTVAVDT
HHHCCCEEEECCCCCEEEEECCCCCCCCEEEEEEEEECCCCCCEEEEEEEECCEEEEEEC
TAPFAFTWDSAGVANGMANLTAYAFDAAGNSKASTTVSVNVANGTTTVARDTTAPQVKIV
CCCEEEEECCCCHHCCHHHEEEEEEECCCCCCCCEEEEEEECCCCEEEEECCCCCEEEEE
NPVTGNVSGSNVAISVNASDDSGASGITCTLYIDGVLKATGKGSTLGYSWNTRPSNVRAG
CCCCCCCCCCEEEEEEECCCCCCCCCEEEEEEEEEEEEECCCCCEEEEECCCCCCCCCCC
AHTIWTVARDAAGNTASASVNVTVIK
CEEEEEEECCCCCCCCCCEEEEEEEC
>Mature Secondary Structure
MNADKREEQAGVAARLAERFISNIRAKVASSSCRFAGAILAVLLGLGPVISSAEPPEGRG
CCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHCCHHHCCCCCCCCCC
PGMNKPVGWAKGRILVMPRAGLPEKELAKVLGEHGGKGRKIGQSDLYIVDLPGNASEKAV
CCCCCCCCCCCCEEEEEECCCCCHHHHHHHHHHCCCCCCEECCCCEEEEECCCCCCHHHH
AARLAHHPALKFAEIDQEVEPALIPNDPYYGSAWHLPKIGAPSAWDSSLGSGVTIAILDS
HHHHHHCCCCCHHHCCCCCCCCCCCCCCCCCCEECCCCCCCCCCCCHHCCCCEEEEEEEC
GVDSTHPDLATELVPGWNFYENNSNTSDVYGHGTKVAGAAGAAGNNALGVASVAARAKIM
CCCCCCCCHHHHHCCCCCEECCCCCCCCEECCCCEECCCCCCCCCCCCCHHHHHHCEEEE
PIRVSGSDGYATWSAISQGLIYAADRGVRVANASFLGLTDSASTRSAAQYLKNKGGLVIV
EEEEECCCCCEEHHHHHCCEEEEECCCEEEECCEEEEECCCCCHHHHHHHHHCCCCEEEE
SGGNTGVQQNYAATTSMIPVSATDGNDVRTSWSSYGNYIALAAPGAGIWSTTKGGGYGAV
ECCCCCCCCCCEEEEEEEEEECCCCCCCCCCHHHCCCEEEEECCCCCCCCCCCCCCEEEC
SGTSFSSPVTAGVVALMMAAKPTLSNTQIESLLYSTAVDLGTPGRDPYYGYGRVNAARAV
CCCCCCCCHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHCCCCCCCCCCCCCCCCHHHHH
QAAAGTTLTADTQAPAVSITSPAGGSSVTGLVGVNVAASDNVGVTRVELRVNNTTVAVDT
HHHCCCEEEECCCCCEEEEECCCCCCCCEEEEEEEEECCCCCCEEEEEEEECCEEEEEEC
TAPFAFTWDSAGVANGMANLTAYAFDAAGNSKASTTVSVNVANGTTTVARDTTAPQVKIV
CCCEEEEECCCCHHCCHHHEEEEEEECCCCCCCCEEEEEEECCCCEEEEECCCCCEEEEE
NPVTGNVSGSNVAISVNASDDSGASGITCTLYIDGVLKATGKGSTLGYSWNTRPSNVRAG
CCCCCCCCCCEEEEEEECCCCCCCCCEEEEEEEEEEEEECCCCCEEEEECCCCCCCCCCC
AHTIWTVARDAAGNTASASVNVTVIK
CEEEEEEECCCCCCCCCCEEEEEEEC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 2647518; 2689655; 2196375; 1993669 [H]