Definition Nitrosospira multiformis ATCC 25196 chromosome, complete genome.
Accession NC_007614
Length 3,184,243

Click here to switch to the map view.

The map label for this gene is 82703009

Identifier: 82703009

GI number: 82703009

Start: 2173441

End: 2175321

Strand: Reverse

Name: 82703009

Synonym: Nmul_A1888

Alternate gene names: NA

Gene position: 2175321-2173441 (Counterclockwise)

Preceding gene: 82703011

Following gene: 82703002

Centisome position: 68.32

GC content: 58.75

Gene sequence:

>1881_bases
GTGAATATCAATCATAAAGCGCCTGCAACTGGCTCAAGAGAACCCGCTTCAGGCATTATTCAATCAAGCACTCGCAACTC
GCAGCACATCTCCAAACCTTGGTATCCCCTTTGGAGCGGCATACTGGCAGTTTTGCTGGGATTGGGTCCGGTCATTTCCA
GTGCAGAGCCTCCGGAGGGCAGGGGGCCTGGAATGAACAAGCCGCTTGGCTGGGCGAAGGGTCGCATCCTGGTCATGCCG
CGTGCCGGCTTGCCGGAAAAGGAACTGGCCAAGGTTCTGGGCGAACATGGCGGCAAGGGCAGGAAGATCGGGCAGAGCGA
TCTGTACATCGTCGACTTGCCGGGTAATGCCTCTGAGAAGGCGGTGGCGGCAAGGCTTGCGCATCATCCGGCGCTCAAGT
TTGCCGAGATCGACCAGGAAGTCGAACCCGCGCTCATACCGAACGATCCCTACTATGGCAGCGCCTGGCATTTGCCCAAG
ATTGGCGCTCCGTCCGCCTGGGACAGTTCCCTGGGCAGCGGCGTGACCATCGCCATCCTGGATTCAGGAGTTGACCCGAA
TCACCCTGATCTCTCACCCCAGCTTGTTCCAGGCTGGAATTTCTACGAAAACAATTCCAACACGTCGGATGTTTACGGGC
ATGGAACCAAGGTTGCAGGGTCAGCGGCAGCCATGGCAAACAATGCCCAAGGCGTTGCCGGCGTGGCGGCGTTGGCTAAA
ATAATGCCTGTCCGCGTGAGCGGGAGTACTGGATATGCCACCTGGAGTGCGATTTCCCAAGGGCTTATCTATGCGGCAGA
CCGCGGCGTTCGCGTCGCCAATGCCAGCTTCCTCGGACTGACCGACAGTGCGAGCACCCGGAGCGCGGCGCAATACATGA
AGGATAAAGGTGGCCTGGTGATCGTGAGTGGCGGAAATACGGGAGTGCTCCAGAATTATGCAGTAACGACATCGATGGTA
GCTGTAGCCGCTACAGATGCGAACGACTTCAGAGCCAGTTGGTCGAGCTACGGAAACTACATCTCCCTTGCCGCGCCTGG
AGCCGGAATTTGGACGACGACTATGGGGGGCGGCTATGGCGCGGCTTCCGGCACATCATTCTCAAGTCCGGTAACGGCCG
GCGTGGTGGCGCTCATGATGGCGGCAAAGCCGACATTATCCAATACCCAGATCGAGAGTCTGCTGTTTTCAACTGCCGTG
GATCTGGGCACAGCGGGGCGCGATCCCTATTATGGCTATGGACGGGTTGATGCTGCACGCGCGGTGCAGGCGGCGGCCTC
GGCAGTGGTCGCCGGAGACACGCAGGCCCCGGCGGTTTCCATCACTTCCCCTGCTGGCGGATCAAGCGTAACAGGTCTGG
TCGGCGTAAACGTGGCTGCGAGCGATAACGTCGGCGTGACCCGTGTCGAGTTGCGGGTCAACAATACCACAGTCGCAGTC
GACACCACGGCGCCGTTCGCCTTCACCTGGGATTCGGCAGGCGTAGCCAACGGTATGGCGAACCTGACCGCTTATGCATT
CGATGCGGCCGGCAACTCCAAGGCTTCGACCACCGTCTCGGTGAATGTGGCAAACGGAACGACAACGGTGGCCAGGGATA
CTACCGCGCCACAGGTGAAGATCGTAAATCCGGTCACAGGCAATGTTTCGGGAAGCAACGTGCCCATCAGCGTAAATGCA
AGCGATGATAGCGGCGCTTCCGGAATTACCTATGCGCTCTACATCGACGGCGTGCTCAAGGCTACCGGAAAGGGAAGTAC
GCTGGGTTACAACTGGAATATACGTAATGTTGCCGCGGGTGCACATACTGTTCAGGTAGTCGCCAAGGATGCGGCGGGAA
ATAGCGCATCCTCATCCGTCAGCGTGACGGTAGTCAAGTAG

Upstream 100 bases:

>100_bases
CTATTAGAACGTGTTGAGTGGATCTCGATGCTCCGGCTCAGTACGTTTTTCGGCACCCGGCCTATCTAGGCGGTTCCGCC
TCCCCAAGAGGAGGAACTAC

Downstream 100 bases:

>100_bases
CGGGAGGTGGAAGGTCGTTTTTTCGGGTTGGCAAAGCCGGGCCAAAAGGAAGGAAGCCCGGCTTTGTTTTGCTTCACGAG
TGATGCTGTTGGCTTATCGA

Product: peptidase S8/S53 subtilisin kexin sedolisin

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 626; Mature: 626

Protein sequence:

>626_residues
MNINHKAPATGSREPASGIIQSSTRNSQHISKPWYPLWSGILAVLLGLGPVISSAEPPEGRGPGMNKPLGWAKGRILVMP
RAGLPEKELAKVLGEHGGKGRKIGQSDLYIVDLPGNASEKAVAARLAHHPALKFAEIDQEVEPALIPNDPYYGSAWHLPK
IGAPSAWDSSLGSGVTIAILDSGVDPNHPDLSPQLVPGWNFYENNSNTSDVYGHGTKVAGSAAAMANNAQGVAGVAALAK
IMPVRVSGSTGYATWSAISQGLIYAADRGVRVANASFLGLTDSASTRSAAQYMKDKGGLVIVSGGNTGVLQNYAVTTSMV
AVAATDANDFRASWSSYGNYISLAAPGAGIWTTTMGGGYGAASGTSFSSPVTAGVVALMMAAKPTLSNTQIESLLFSTAV
DLGTAGRDPYYGYGRVDAARAVQAAASAVVAGDTQAPAVSITSPAGGSSVTGLVGVNVAASDNVGVTRVELRVNNTTVAV
DTTAPFAFTWDSAGVANGMANLTAYAFDAAGNSKASTTVSVNVANGTTTVARDTTAPQVKIVNPVTGNVSGSNVPISVNA
SDDSGASGITYALYIDGVLKATGKGSTLGYNWNIRNVAAGAHTVQVVAKDAAGNSASSSVSVTVVK

Sequences:

>Translated_626_residues
MNINHKAPATGSREPASGIIQSSTRNSQHISKPWYPLWSGILAVLLGLGPVISSAEPPEGRGPGMNKPLGWAKGRILVMP
RAGLPEKELAKVLGEHGGKGRKIGQSDLYIVDLPGNASEKAVAARLAHHPALKFAEIDQEVEPALIPNDPYYGSAWHLPK
IGAPSAWDSSLGSGVTIAILDSGVDPNHPDLSPQLVPGWNFYENNSNTSDVYGHGTKVAGSAAAMANNAQGVAGVAALAK
IMPVRVSGSTGYATWSAISQGLIYAADRGVRVANASFLGLTDSASTRSAAQYMKDKGGLVIVSGGNTGVLQNYAVTTSMV
AVAATDANDFRASWSSYGNYISLAAPGAGIWTTTMGGGYGAASGTSFSSPVTAGVVALMMAAKPTLSNTQIESLLFSTAV
DLGTAGRDPYYGYGRVDAARAVQAAASAVVAGDTQAPAVSITSPAGGSSVTGLVGVNVAASDNVGVTRVELRVNNTTVAV
DTTAPFAFTWDSAGVANGMANLTAYAFDAAGNSKASTTVSVNVANGTTTVARDTTAPQVKIVNPVTGNVSGSNVPISVNA
SDDSGASGITYALYIDGVLKATGKGSTLGYNWNIRNVAAGAHTVQVVAKDAAGNSASSSVSVTVVK
>Mature_626_residues
MNINHKAPATGSREPASGIIQSSTRNSQHISKPWYPLWSGILAVLLGLGPVISSAEPPEGRGPGMNKPLGWAKGRILVMP
RAGLPEKELAKVLGEHGGKGRKIGQSDLYIVDLPGNASEKAVAARLAHHPALKFAEIDQEVEPALIPNDPYYGSAWHLPK
IGAPSAWDSSLGSGVTIAILDSGVDPNHPDLSPQLVPGWNFYENNSNTSDVYGHGTKVAGSAAAMANNAQGVAGVAALAK
IMPVRVSGSTGYATWSAISQGLIYAADRGVRVANASFLGLTDSASTRSAAQYMKDKGGLVIVSGGNTGVLQNYAVTTSMV
AVAATDANDFRASWSSYGNYISLAAPGAGIWTTTMGGGYGAASGTSFSSPVTAGVVALMMAAKPTLSNTQIESLLFSTAV
DLGTAGRDPYYGYGRVDAARAVQAAASAVVAGDTQAPAVSITSPAGGSSVTGLVGVNVAASDNVGVTRVELRVNNTTVAV
DTTAPFAFTWDSAGVANGMANLTAYAFDAAGNSKASTTVSVNVANGTTTVARDTTAPQVKIVNPVTGNVSGSNVPISVNA
SDDSGASGITYALYIDGVLKATGKGSTLGYNWNIRNVAAGAHTVQVVAKDAAGNSASSSVSVTVVK

Specific function: Unknown

COG id: COG1404

COG function: function code O; Subtilisin-like serine proteases

Gene ontology:

Cell location: Secreted [H]

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Belongs to the peptidase S8 family [H]

Homologues:

Organism=Homo sapiens, GI76443679, Length=347, Percent_Identity=28.5302593659942, Blast_Score=86, Evalue=9e-17,
Organism=Homo sapiens, GI4505579, Length=403, Percent_Identity=26.302729528536, Blast_Score=75, Evalue=2e-13,
Organism=Caenorhabditis elegans, GI71988312, Length=308, Percent_Identity=29.8701298701299, Blast_Score=76, Evalue=6e-14,
Organism=Caenorhabditis elegans, GI71988321, Length=308, Percent_Identity=29.8701298701299, Blast_Score=76, Evalue=6e-14,
Organism=Caenorhabditis elegans, GI71988308, Length=308, Percent_Identity=29.8701298701299, Blast_Score=76, Evalue=6e-14,
Organism=Caenorhabditis elegans, GI71988297, Length=308, Percent_Identity=29.8701298701299, Blast_Score=76, Evalue=6e-14,
Organism=Caenorhabditis elegans, GI71988315, Length=308, Percent_Identity=29.8701298701299, Blast_Score=76, Evalue=7e-14,
Organism=Caenorhabditis elegans, GI71988301, Length=308, Percent_Identity=29.8701298701299, Blast_Score=75, Evalue=9e-14,
Organism=Caenorhabditis elegans, GI25141268, Length=396, Percent_Identity=25.5050505050505, Blast_Score=74, Evalue=3e-13,
Organism=Caenorhabditis elegans, GI71983555, Length=396, Percent_Identity=25.7575757575758, Blast_Score=73, Evalue=4e-13,
Organism=Saccharomyces cerevisiae, GI6324576, Length=291, Percent_Identity=28.1786941580756, Blast_Score=78, Evalue=4e-15,
Organism=Saccharomyces cerevisiae, GI6324091, Length=340, Percent_Identity=26.4705882352941, Blast_Score=76, Evalue=1e-14,
Organism=Saccharomyces cerevisiae, GI6320775, Length=293, Percent_Identity=26.962457337884, Blast_Score=75, Evalue=3e-14,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR000209
- InterPro:   IPR022398
- InterPro:   IPR015500 [H]

Pfam domain/function: PF00082 Peptidase_S8 [H]

EC number: =3.4.21.66 [H]

Molecular weight: Translated: 63467; Mature: 63467

Theoretical pI: Translated: 8.52; Mature: 8.52

Prosite motif: PS00584 PFKB_KINASES_2 ; PS00136 SUBTILASE_ASP ; PS00137 SUBTILASE_HIS ; PS00138 SUBTILASE_SER

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.0 %Cys     (Translated Protein)
1.8 %Met     (Translated Protein)
1.8 %Cys+Met (Translated Protein)
0.0 %Cys     (Mature Protein)
1.8 %Met     (Mature Protein)
1.8 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MNINHKAPATGSREPASGIIQSSTRNSQHISKPWYPLWSGILAVLLGLGPVISSAEPPEG
CCCCCCCCCCCCCCCCCHHHHCCCCCCCCCCCCCHHHHHHHHHHHHHCCHHHCCCCCCCC
RGPGMNKPLGWAKGRILVMPRAGLPEKELAKVLGEHGGKGRKIGQSDLYIVDLPGNASEK
CCCCCCCCCCCCCCEEEEEECCCCCHHHHHHHHHHCCCCCCEECCCCEEEEECCCCCCHH
AVAARLAHHPALKFAEIDQEVEPALIPNDPYYGSAWHLPKIGAPSAWDSSLGSGVTIAIL
HHHHHHHHCCCCCHHHCCCCCCCCCCCCCCCCCCEECCCCCCCCCCCCHHCCCCEEEEEE
DSGVDPNHPDLSPQLVPGWNFYENNSNTSDVYGHGTKVAGSAAAMANNAQGVAGVAALAK
ECCCCCCCCCCCCEEECCCCEECCCCCCCCEECCCCEECCCHHHHCCCCCCHHHHHHHHH
IMPVRVSGSTGYATWSAISQGLIYAADRGVRVANASFLGLTDSASTRSAAQYMKDKGGLV
HEEEEEECCCCCEEHHHHHCCEEEEECCCEEEECCEEEEECCCCCHHHHHHHHHCCCCEE
IVSGGNTGVLQNYAVTTSMVAVAATDANDFRASWSSYGNYISLAAPGAGIWTTTMGGGYG
EEECCCCCEEEEEEEEEEEEEEEECCCHHHHHHHHHCCCEEEEECCCCCEEEEECCCCCC
AASGTSFSSPVTAGVVALMMAAKPTLSNTQIESLLFSTAVDLGTAGRDPYYGYGRVDAAR
CCCCCCCCCCHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHCCCCCCCCCCCCCCHHHHH
AVQAAASAVVAGDTQAPAVSITSPAGGSSVTGLVGVNVAASDNVGVTRVELRVNNTTVAV
HHHHHHHEEEECCCCCCEEEEECCCCCCCCEEEEEEEEECCCCCCEEEEEEEECCEEEEE
DTTAPFAFTWDSAGVANGMANLTAYAFDAAGNSKASTTVSVNVANGTTTVARDTTAPQVK
ECCCCEEEEECCCCHHCCHHHEEEEEEECCCCCCCCEEEEEEECCCCEEEEECCCCCEEE
IVNPVTGNVSGSNVPISVNASDDSGASGITYALYIDGVLKATGKGSTLGYNWNIRNVAAG
EECCCCCCCCCCCEEEEEECCCCCCCCCEEEEEEEEEEEEECCCCCEEEEECCCCEEECC
AHTVQVVAKDAAGNSASSSVSVTVVK
CEEEEEEEECCCCCCCCCEEEEEEEC
>Mature Secondary Structure
MNINHKAPATGSREPASGIIQSSTRNSQHISKPWYPLWSGILAVLLGLGPVISSAEPPEG
CCCCCCCCCCCCCCCCCHHHHCCCCCCCCCCCCCHHHHHHHHHHHHHCCHHHCCCCCCCC
RGPGMNKPLGWAKGRILVMPRAGLPEKELAKVLGEHGGKGRKIGQSDLYIVDLPGNASEK
CCCCCCCCCCCCCCEEEEEECCCCCHHHHHHHHHHCCCCCCEECCCCEEEEECCCCCCHH
AVAARLAHHPALKFAEIDQEVEPALIPNDPYYGSAWHLPKIGAPSAWDSSLGSGVTIAIL
HHHHHHHHCCCCCHHHCCCCCCCCCCCCCCCCCCEECCCCCCCCCCCCHHCCCCEEEEEE
DSGVDPNHPDLSPQLVPGWNFYENNSNTSDVYGHGTKVAGSAAAMANNAQGVAGVAALAK
ECCCCCCCCCCCCEEECCCCEECCCCCCCCEECCCCEECCCHHHHCCCCCCHHHHHHHHH
IMPVRVSGSTGYATWSAISQGLIYAADRGVRVANASFLGLTDSASTRSAAQYMKDKGGLV
HEEEEEECCCCCEEHHHHHCCEEEEECCCEEEECCEEEEECCCCCHHHHHHHHHCCCCEE
IVSGGNTGVLQNYAVTTSMVAVAATDANDFRASWSSYGNYISLAAPGAGIWTTTMGGGYG
EEECCCCCEEEEEEEEEEEEEEEECCCHHHHHHHHHCCCEEEEECCCCCEEEEECCCCCC
AASGTSFSSPVTAGVVALMMAAKPTLSNTQIESLLFSTAVDLGTAGRDPYYGYGRVDAAR
CCCCCCCCCCHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHCCCCCCCCCCCCCCHHHHH
AVQAAASAVVAGDTQAPAVSITSPAGGSSVTGLVGVNVAASDNVGVTRVELRVNNTTVAV
HHHHHHHEEEECCCCCCEEEEECCCCCCCCEEEEEEEEECCCCCCEEEEEEEECCEEEEE
DTTAPFAFTWDSAGVANGMANLTAYAFDAAGNSKASTTVSVNVANGTTTVARDTTAPQVK
ECCCCEEEEECCCCHHCCHHHEEEEEEECCCCCCCCEEEEEEECCCCEEEEECCCCCEEE
IVNPVTGNVSGSNVPISVNASDDSGASGITYALYIDGVLKATGKGSTLGYNWNIRNVAAG
EECCCCCCCCCCCEEEEEECCCCCCCCCEEEEEEEEEEEEECCCCCEEEEECCCCEEECC
AHTVQVVAKDAAGNSASSSVSVTVVK
CEEEEEEEECCCCCCCCCEEEEEEEC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 2647518; 2689655; 2196375; 1993669 [H]