Definition Shewanella pealeana ATCC 700345 chromosome, complete genome.
Accession NC_009901
Length 5,174,581

Click here to switch to the map view.

The map label for this gene is 157962575

Identifier: 157962575

GI number: 157962575

Start: 3365183

End: 3368101

Strand: Reverse

Name: 157962575

Synonym: Spea_2754

Alternate gene names: NA

Gene position: 3368101-3365183 (Counterclockwise)

Preceding gene: 157962584

Following gene: 157962574

Centisome position: 65.09

GC content: 44.43

Gene sequence:

>2919_bases
ATGTCAATCAAATCATCTAAATCACAAGCTAAAAAGGGTCAGTTTAAAGTTCATGCTTTAGCCTTGGCTTGTTCAGCTAT
TCTGTTTCCTAGCGCTGCGTTAGCAACATCTGAAGTCGCACCAACTGAAAAGGCTTCATCTAAAGCCGCTCACGGAAAAG
ATCTGAAAAGTCGCTTTGAAAAGGGCGCTAATGTGCCTGGTAAGCAAAAAAATGCTGAAAAGACTCAACGTCAGAATATC
GATAAGAGTAAAGAACAGAAAGTTGAAGGACCAATGGGGGCTGTTGGTTCCGTAGGTCCTGCAGCTGAATCTGAAGCAGA
GGTATGTAGTAGTGAGCTTGCAGCATTAAGTGGCCAAGAGTTATTTAATTATGTGAGAGAAGCCGATATTTCTTGTATCT
CTGCGCTTTATTCACGTAACGATGCAGTATCTGTTGCAGCTTACCAGACTGAAAATGTGGTTTCGGTTGCTAATCAAGCG
GCCTCTATGGCAGCGACTTACGACAGCAGCACAGGTTATGAAATGCGTAACTTGTTCTACTTCTTACGCGGTGCATTTTA
CATTGAGTTCTATAACGACGACCTAACTTATAGTGATACCCTAGCCGCTGATGCCGTTTACGGTGCGTTAGTTGAGTATT
CAAAGAACCCTAAGCTTTTTGAGATCACTCATTCTGCTGGTGACACTTTAATGGAGTTTTTCACTTCATGGTCGAGCGCC
GATCGAATCCTTGAAAGCGTGCCTTTAATTACAGATTACCTGCAGATGTTTAATGCTGACTTCTTAGCAAGTAATCGCCA
CCGCGCAGCGATGACAAGTGCACTGACTACACTTTATTACGGTAGTTGGGCTGAGGATTACAATAAGCTAGCCATGGAGC
ATGGTGAGCTAATAGATGCGCTACTGAATATTGCGACTGCTGATTATATTATTAACTCTGATTACCAGTATGAATCGACA
GATGCTTTTCATGAGTTTGGTCGCTTCTATGAGTATCAAGCGTATTGGGATCTACCACAAAGCTTAAAAACACGCCTAAA
TGACGGTGTAGAGCTCTACATGAGCAAGTTTGAACGTATGTCTGCTGAGTGGGCTGACGGTGCAGGCTATCTAGATTATT
ATAACCCAGGTGATTGCGAACAGTTTGGGATATGTGGCTGGGAAGAGGAGCTTGAACAGACGGCATTACCTATCAACTAC
AACTGTAGTGATACCATCTATATTCGTGCTCAGCAGTTAACTAATGATGAGCTACAAGCCTCTTGTGATCTTATGGGAGG
AGAAGAAACACTGTTCCATAATGTACTCGCAACGGGTTACCAGCCAGTTGCCGATGATTTGAATGAAAGCTTAGAAGTTA
ATATTTTCGATAGCTACGATGACTATGCCCAGTATGCCGGTGTGATTTTTGGTATTAGTACTGACAATGGTGGTATGTAC
CTAGAGGGGACACCTTCACAAGAAGGTAATCAGGCGCGTTTTATTGCGCATGAAGCAACCTGGACTGAAGATATTTTAGT
TTGGAACCTTAAGCACGAATATGTTCATTATCTAGATGGCCGCTTTAATCAATATGGTGCGTTTAACTACTTTGATATCG
ATACGGGTAAATCTGTTTGGTGGTCAGAAGGTCTAGCCGAGTACATATCTAAGCAGAACCGTAATGACGGTGCTGTCGAT
ATGGGGCGCTCTCAGGCCTATAGCCTCAGCGAAATCCTAGCGAATACCTATAACAGTGGTTCAGATCGCGTTTATAGCTG
GGGTTATCTAGCGGTGCGTTTCCTATTTGAAAACCACAGAAGTGATGTTGACGAATTATTAGTGCTAGCACGTGGTGGTG
ACGCCGATGGTTGGTTGGCTTATATCGATAACACTATTGGTCAAAACTATAACAGCGAGTGGAACACTTGGTTGACTTCA
GTGACCAGTAATGATGAGTCAATTGCTATTGATATAACTGATCCAATTGATTCAGATGGTGACGGCGTAGCCGATGACCA
AGACGCTTTCCCCCATGATCCGAGTGAAACCCGCGATACTGATGGTGACGGTGTTGGTGATAATGCAGATGCGTTCCCAA
CCGATGCTAGCGAAACGGTCGATACCGACGGTGATGGCGTGGGTGACAACGGTGATGTATTCCCAACAGATCCTACTGAG
TGGGCAGATTCGGATGGTGATGGCATCGGTGATAATGCAGATACTGATGAGCCAAATAAGCCTGTCGAGCATTGCGGCGT
AGCAACCATTAGAGATGGCAAGCTAACTCAAGATAAAGTTGAGTGTGTTGAAGGTACAGATATTAACTATTTCTACACCT
ATGTAGAGGAAGATAACACGCCGCTTTATATCAGCACCTCTGGCGGTGAAGGTGATGTGGATCTGTTCTTCAATCAAGAT
ATCTGGGCTAAGCCATCGGACTTTGATGCAAGATCTGAAAACGATGGTAACGAAGAATCGCTAAGCGTGATTGCTAATAG
TGGTTGGGTATATGTGAGCCTACTCGCACACCAAGACTTTGACGGTGTCAGCCTTAAGGTTAGCCTAACAGAGGAGGGCG
ATACAGGCACAACTCCTGTAGCAGTTGCTGATGCATGTGCAACACAATCTCCATATAGCTATGGTGGCGTTGAGTTTGGC
GAGGCTATCTGTATCGAAGATGGTCACTCAAGCTACTACTTCTATGTGCCTACAGGTACTGAAGAGGTTACTGTTGCAAG
TGGTCATGGTAGCGGTAATGTGAATCTATATGGTAATAGCCAGACTTGGGCTGGTCCTGACTCATTCGAAGTTAAGTCTG
AAAATGCGGATAATGTTGAAAGCCTAACAATCTCAGCTCCAGCAGAAGGTTGGTACTACATCAGTGCCGATGGTGCGCCA
TCGAGCGAAGGTGCAAGCTTGGTGGTTAACATTAAGTAA

Upstream 100 bases:

>100_bases
CGCAACAACAAGCGCGGCAAGCAAACCCGATATCAGTCCGATTATCACTTTCCTGTATTAGGTGGTTTAACGACATAGCC
GCGAATAATTGGAGTCAAAC

Downstream 100 bases:

>100_bases
CAAGACTATTAAAAAATAGTAGCTGACTAAAGCCGACTCTTTATGAGCCGACTCTTTATGAGTCGGCTTTTTATTTGAGT
TAAAAAATAGCTTAACTAAA

Product: collagenase

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 972; Mature: 971

Protein sequence:

>972_residues
MSIKSSKSQAKKGQFKVHALALACSAILFPSAALATSEVAPTEKASSKAAHGKDLKSRFEKGANVPGKQKNAEKTQRQNI
DKSKEQKVEGPMGAVGSVGPAAESEAEVCSSELAALSGQELFNYVREADISCISALYSRNDAVSVAAYQTENVVSVANQA
ASMAATYDSSTGYEMRNLFYFLRGAFYIEFYNDDLTYSDTLAADAVYGALVEYSKNPKLFEITHSAGDTLMEFFTSWSSA
DRILESVPLITDYLQMFNADFLASNRHRAAMTSALTTLYYGSWAEDYNKLAMEHGELIDALLNIATADYIINSDYQYEST
DAFHEFGRFYEYQAYWDLPQSLKTRLNDGVELYMSKFERMSAEWADGAGYLDYYNPGDCEQFGICGWEEELEQTALPINY
NCSDTIYIRAQQLTNDELQASCDLMGGEETLFHNVLATGYQPVADDLNESLEVNIFDSYDDYAQYAGVIFGISTDNGGMY
LEGTPSQEGNQARFIAHEATWTEDILVWNLKHEYVHYLDGRFNQYGAFNYFDIDTGKSVWWSEGLAEYISKQNRNDGAVD
MGRSQAYSLSEILANTYNSGSDRVYSWGYLAVRFLFENHRSDVDELLVLARGGDADGWLAYIDNTIGQNYNSEWNTWLTS
VTSNDESIAIDITDPIDSDGDGVADDQDAFPHDPSETRDTDGDGVGDNADAFPTDASETVDTDGDGVGDNGDVFPTDPTE
WADSDGDGIGDNADTDEPNKPVEHCGVATIRDGKLTQDKVECVEGTDINYFYTYVEEDNTPLYISTSGGEGDVDLFFNQD
IWAKPSDFDARSENDGNEESLSVIANSGWVYVSLLAHQDFDGVSLKVSLTEEGDTGTTPVAVADACATQSPYSYGGVEFG
EAICIEDGHSSYYFYVPTGTEEVTVASGHGSGNVNLYGNSQTWAGPDSFEVKSENADNVESLTISAPAEGWYYISADGAP
SSEGASLVVNIK

Sequences:

>Translated_972_residues
MSIKSSKSQAKKGQFKVHALALACSAILFPSAALATSEVAPTEKASSKAAHGKDLKSRFEKGANVPGKQKNAEKTQRQNI
DKSKEQKVEGPMGAVGSVGPAAESEAEVCSSELAALSGQELFNYVREADISCISALYSRNDAVSVAAYQTENVVSVANQA
ASMAATYDSSTGYEMRNLFYFLRGAFYIEFYNDDLTYSDTLAADAVYGALVEYSKNPKLFEITHSAGDTLMEFFTSWSSA
DRILESVPLITDYLQMFNADFLASNRHRAAMTSALTTLYYGSWAEDYNKLAMEHGELIDALLNIATADYIINSDYQYEST
DAFHEFGRFYEYQAYWDLPQSLKTRLNDGVELYMSKFERMSAEWADGAGYLDYYNPGDCEQFGICGWEEELEQTALPINY
NCSDTIYIRAQQLTNDELQASCDLMGGEETLFHNVLATGYQPVADDLNESLEVNIFDSYDDYAQYAGVIFGISTDNGGMY
LEGTPSQEGNQARFIAHEATWTEDILVWNLKHEYVHYLDGRFNQYGAFNYFDIDTGKSVWWSEGLAEYISKQNRNDGAVD
MGRSQAYSLSEILANTYNSGSDRVYSWGYLAVRFLFENHRSDVDELLVLARGGDADGWLAYIDNTIGQNYNSEWNTWLTS
VTSNDESIAIDITDPIDSDGDGVADDQDAFPHDPSETRDTDGDGVGDNADAFPTDASETVDTDGDGVGDNGDVFPTDPTE
WADSDGDGIGDNADTDEPNKPVEHCGVATIRDGKLTQDKVECVEGTDINYFYTYVEEDNTPLYISTSGGEGDVDLFFNQD
IWAKPSDFDARSENDGNEESLSVIANSGWVYVSLLAHQDFDGVSLKVSLTEEGDTGTTPVAVADACATQSPYSYGGVEFG
EAICIEDGHSSYYFYVPTGTEEVTVASGHGSGNVNLYGNSQTWAGPDSFEVKSENADNVESLTISAPAEGWYYISADGAP
SSEGASLVVNIK
>Mature_971_residues
SIKSSKSQAKKGQFKVHALALACSAILFPSAALATSEVAPTEKASSKAAHGKDLKSRFEKGANVPGKQKNAEKTQRQNID
KSKEQKVEGPMGAVGSVGPAAESEAEVCSSELAALSGQELFNYVREADISCISALYSRNDAVSVAAYQTENVVSVANQAA
SMAATYDSSTGYEMRNLFYFLRGAFYIEFYNDDLTYSDTLAADAVYGALVEYSKNPKLFEITHSAGDTLMEFFTSWSSAD
RILESVPLITDYLQMFNADFLASNRHRAAMTSALTTLYYGSWAEDYNKLAMEHGELIDALLNIATADYIINSDYQYESTD
AFHEFGRFYEYQAYWDLPQSLKTRLNDGVELYMSKFERMSAEWADGAGYLDYYNPGDCEQFGICGWEEELEQTALPINYN
CSDTIYIRAQQLTNDELQASCDLMGGEETLFHNVLATGYQPVADDLNESLEVNIFDSYDDYAQYAGVIFGISTDNGGMYL
EGTPSQEGNQARFIAHEATWTEDILVWNLKHEYVHYLDGRFNQYGAFNYFDIDTGKSVWWSEGLAEYISKQNRNDGAVDM
GRSQAYSLSEILANTYNSGSDRVYSWGYLAVRFLFENHRSDVDELLVLARGGDADGWLAYIDNTIGQNYNSEWNTWLTSV
TSNDESIAIDITDPIDSDGDGVADDQDAFPHDPSETRDTDGDGVGDNADAFPTDASETVDTDGDGVGDNGDVFPTDPTEW
ADSDGDGIGDNADTDEPNKPVEHCGVATIRDGKLTQDKVECVEGTDINYFYTYVEEDNTPLYISTSGGEGDVDLFFNQDI
WAKPSDFDARSENDGNEESLSVIANSGWVYVSLLAHQDFDGVSLKVSLTEEGDTGTTPVAVADACATQSPYSYGGVEFGE
AICIEDGHSSYYFYVPTGTEEVTVASGHGSGNVNLYGNSQTWAGPDSFEVKSENADNVESLTISAPAEGWYYISADGAPS
SEGASLVVNIK

Specific function: Unknown

COG id: NA

COG function: NA

Gene ontology:

Cell location: Secreted [H]

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Contains 1 PKD domain [H]

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR013510
- InterPro:   IPR002169
- InterPro:   IPR013661
- InterPro:   IPR022409
- InterPro:   IPR000601 [H]

Pfam domain/function: PF01752 Peptidase_M9; PF08453 Peptidase_M9_N; PF00801 PKD [H]

EC number: =3.4.24.3 [H]

Molecular weight: Translated: 106567; Mature: 106436

Theoretical pI: Translated: 3.87; Mature: 3.87

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.1 %Cys     (Translated Protein)
1.3 %Met     (Translated Protein)
2.5 %Cys+Met (Translated Protein)
1.1 %Cys     (Mature Protein)
1.2 %Met     (Mature Protein)
2.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSIKSSKSQAKKGQFKVHALALACSAILFPSAALATSEVAPTEKASSKAAHGKDLKSRFE
CCCCCCHHHHHCCCEEHHHHHHHHHHHHCCCHHHHHCCCCCCHHHCCCCCCCHHHHHHHH
KGANVPGKQKNAEKTQRQNIDKSKEQKVEGPMGAVGSVGPAAESEAEVCSSELAALSGQE
HCCCCCCCCCCHHHHHHHCCCHHHHHHHCCCCCCCCCCCCCCCCHHHHHHHHHHHCCHHH
LFNYVREADISCISALYSRNDAVSVAAYQTENVVSVANQAASMAATYDSSTGYEMRNLFY
HHHHHHHHHHHHHHHHHCCCCCEEEEEECCCHHHHHHHHHHHHEEECCCCCCHHHHHHHH
FLRGAFYIEFYNDDLTYSDTLAADAVYGALVEYSKNPKLFEITHSAGDTLMEFFTSWSSA
HHCCEEEEEEECCCCCCCHHHHHHHHHHHHHHHCCCCCEEEEECCCCHHHHHHHHHHHHH
DRILESVPLITDYLQMFNADFLASNRHRAAMTSALTTLYYGSWAEDYNKLAMEHGELIDA
HHHHHHCCHHHHHHHHHCCHHHCCCCHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHH
LLNIATADYIINSDYQYESTDAFHEFGRFYEYQAYWDLPQSLKTRLNDGVELYMSKFERM
HHHHHHHHEEECCCCCCCCHHHHHHHHHHEEEEEEECCCHHHHHHHCCCHHHHHHHHHHH
SAEWADGAGYLDYYNPGDCEQFGICGWEEELEQTALPINYNCSDTIYIRAQQLTNDELQA
CCCCCCCCCEECCCCCCCCCCCCCCCCHHHHHHCCCCCCCCCCCEEEEEEECCCCCHHHH
SCDLMGGEETLFHNVLATGYQPVADDLNESLEVNIFDSYDDYAQYAGVIFGISTDNGGMY
HHHCCCCHHHHHHHHHHCCCCHHHHHCCCCEEEEEECCCHHHHHHCEEEEEEEECCCCEE
LEGTPSQEGNQARFIAHEATWTEDILVWNLKHEYVHYLDGRFNQYGAFNYFDIDTGKSVW
EECCCCCCCCCEEEEEECCCCCCCEEEEECHHHHHHHHCCCCCCCCCEEEEECCCCCCHH
WSEGLAEYISKQNRNDGAVDMGRSQAYSLSEILANTYNSGSDRVYSWGYLAVRFLFENHR
HHHHHHHHHHHCCCCCCCCCCCCCHHHHHHHHHHHHCCCCCCCEEEHHHHHHHHHHHHCC
SDVDELLVLARGGDADGWLAYIDNTIGQNYNSEWNTWLTSVTSNDESIAIDITDPIDSDG
CCCCCEEEEEECCCCCCEEEEEEHHHCCCCCCCHHHEEEEEECCCCEEEEEECCCCCCCC
DGVADDQDAFPHDPSETRDTDGDGVGDNADAFPTDASETVDTDGDGVGDNGDVFPTDPTE
CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC
WADSDGDGIGDNADTDEPNKPVEHCGVATIRDGKLTQDKVECVEGTDINYFYTYVEEDNT
CCCCCCCCCCCCCCCCCCCCCHHHCCCEEEECCCCCHHHHHHHCCCCCEEEEEEEECCCC
PLYISTSGGEGDVDLFFNQDIWAKPSDFDARSENDGNEESLSVIANSGWVYVSLLAHQDF
EEEEEECCCCCCEEEEECCCCCCCCCCCCCCCCCCCCHHEEEEEECCCEEEEEEEECCCC
DGVSLKVSLTEEGDTGTTPVAVADACATQSPYSYGGVEFGEAICIEDGHSSYYFYVPTGT
CCEEEEEEEECCCCCCCCCEEEHHHHHCCCCCCCCCCCCCCEEEEECCCCEEEEEEECCC
EEVTVASGHGSGNVNLYGNSQTWAGPDSFEVKSENADNVESLTISAPAEGWYYISADGAP
CEEEEEECCCCCEEEEEECCCCCCCCCCCEEECCCCCCCEEEEEECCCCCEEEEECCCCC
SSEGASLVVNIK
CCCCCEEEEEEC
>Mature Secondary Structure 
SIKSSKSQAKKGQFKVHALALACSAILFPSAALATSEVAPTEKASSKAAHGKDLKSRFE
CCCCCHHHHHCCCEEHHHHHHHHHHHHCCCHHHHHCCCCCCHHHCCCCCCCHHHHHHHH
KGANVPGKQKNAEKTQRQNIDKSKEQKVEGPMGAVGSVGPAAESEAEVCSSELAALSGQE
HCCCCCCCCCCHHHHHHHCCCHHHHHHHCCCCCCCCCCCCCCCCHHHHHHHHHHHCCHHH
LFNYVREADISCISALYSRNDAVSVAAYQTENVVSVANQAASMAATYDSSTGYEMRNLFY
HHHHHHHHHHHHHHHHHCCCCCEEEEEECCCHHHHHHHHHHHHEEECCCCCCHHHHHHHH
FLRGAFYIEFYNDDLTYSDTLAADAVYGALVEYSKNPKLFEITHSAGDTLMEFFTSWSSA
HHCCEEEEEEECCCCCCCHHHHHHHHHHHHHHHCCCCCEEEEECCCCHHHHHHHHHHHHH
DRILESVPLITDYLQMFNADFLASNRHRAAMTSALTTLYYGSWAEDYNKLAMEHGELIDA
HHHHHHCCHHHHHHHHHCCHHHCCCCHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHH
LLNIATADYIINSDYQYESTDAFHEFGRFYEYQAYWDLPQSLKTRLNDGVELYMSKFERM
HHHHHHHHEEECCCCCCCCHHHHHHHHHHEEEEEEECCCHHHHHHHCCCHHHHHHHHHHH
SAEWADGAGYLDYYNPGDCEQFGICGWEEELEQTALPINYNCSDTIYIRAQQLTNDELQA
CCCCCCCCCEECCCCCCCCCCCCCCCCHHHHHHCCCCCCCCCCCEEEEEEECCCCCHHHH
SCDLMGGEETLFHNVLATGYQPVADDLNESLEVNIFDSYDDYAQYAGVIFGISTDNGGMY
HHHCCCCHHHHHHHHHHCCCCHHHHHCCCCEEEEEECCCHHHHHHCEEEEEEEECCCCEE
LEGTPSQEGNQARFIAHEATWTEDILVWNLKHEYVHYLDGRFNQYGAFNYFDIDTGKSVW
EECCCCCCCCCEEEEEECCCCCCCEEEEECHHHHHHHHCCCCCCCCCEEEEECCCCCCHH
WSEGLAEYISKQNRNDGAVDMGRSQAYSLSEILANTYNSGSDRVYSWGYLAVRFLFENHR
HHHHHHHHHHHCCCCCCCCCCCCCHHHHHHHHHHHHCCCCCCCEEEHHHHHHHHHHHHCC
SDVDELLVLARGGDADGWLAYIDNTIGQNYNSEWNTWLTSVTSNDESIAIDITDPIDSDG
CCCCCEEEEEECCCCCCEEEEEEHHHCCCCCCCHHHEEEEEECCCCEEEEEECCCCCCCC
DGVADDQDAFPHDPSETRDTDGDGVGDNADAFPTDASETVDTDGDGVGDNGDVFPTDPTE
CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC
WADSDGDGIGDNADTDEPNKPVEHCGVATIRDGKLTQDKVECVEGTDINYFYTYVEEDNT
CCCCCCCCCCCCCCCCCCCCCHHHCCCEEEECCCCCHHHHHHHCCCCCEEEEEEEECCCC
PLYISTSGGEGDVDLFFNQDIWAKPSDFDARSENDGNEESLSVIANSGWVYVSLLAHQDF
EEEEEECCCCCCEEEEECCCCCCCCCCCCCCCCCCCCHHEEEEEECCCEEEEEEEECCCC
DGVSLKVSLTEEGDTGTTPVAVADACATQSPYSYGGVEFGEAICIEDGHSSYYFYVPTGT
CCEEEEEEEECCCCCCCCCEEEHHHHHCCCCCCCCCCCCCCEEEEECCCCEEEEEEECCC
EEVTVASGHGSGNVNLYGNSQTWAGPDSFEVKSENADNVESLTISAPAEGWYYISADGAP
CEEEEEECCCCCEEEEEECCCCCCCCCCCEEECCCCCCCEEEEEECCCCCEEEEECCCCC
SSEGASLVVNIK
CCCCCEEEEEEC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 1311172 [H]