Definition Methanobrevibacter smithii ATCC 35061 chromosome, complete genome.
Accession NC_009515
Length 1,853,160

Click here to switch to the map view.

The map label for this gene is gcp

Identifier: 148643258

GI number: 148643258

Start: 1197741

End: 1199357

Strand: Reverse

Name: gcp

Synonym: Msm_1198

Alternate gene names: 148643258

Gene position: 1199357-1197741 (Counterclockwise)

Preceding gene: 148643261

Following gene: 148643255

Centisome position: 64.72

GC content: 34.88

Gene sequence:

>1617_bases
TTGATTGTTTTGATATGTTTAGGAATTGAAGGAACTGCTGAAAAAACAGGTGTAGGAATAGTTGATAGTGACGGAAATAT
ATTGGCTATGGCGGGAGAACAATTATTTCCTGAAAAAGGAGGTATTCATCCTAGAATAGCTGCCGAACATCATGGATATT
GGATTCCAAAGCTAATTCCAAAAGCTATTGATGAAGCGGGAATTTCTTACGATGATTTGGATTTGATCTCTTTTTCACAG
GGTCCTGGTCTTGGGCCTGCTTTAAGAATTGTAGCTACTTCTGCAAGAACACTGGCACTATCATTAAATAAACCGATAAT
TGGTGTTAATCATTGTATTGGGCATGTTGAAGTGGGAAAATTAGATACTGGTGCAGTTAATCCGGTAACACTTTATGTAA
GTGGTGGAAATAGTCAGGTAATCTCTCATGAAAGCGGAAGATATAGGATTTTTGGTGAAACATTAGACATTGCTGCAGGA
AACTGTCTTGATCATTTTGGCCGTGAAACTGGTTTGGGTCATCCGGGAGGTCCGGTAATTGAAAAATTGGCTAAAAAAGG
GTCTTATGTTGATTTGCCATATGTTGTAAAGGGAATGGATTTTTCATTTTCAGGATTATTGTCTGCAGCTTTAAGGGAAG
TTAAAAAAGGCACTCCAATTGAAGATGTTTGTTTTTCACTGCAGGAAACCGCTTTTTCAATGCTTGTTGAAGTAACAGAA
AGGGCACTGTCTCATACACAAAAAGATGAGGTCATGTTATGTGGGGGAGTTTCTGCAAATTCCAGACTCAGGGAAATGCT
TAAGGTAATGGCTGAAGAACACGGAGCCAAATTTTGCATGCCTGAGATGAAACTGTGCGGTGATAATGGAGTAATGATTG
CATGGTTGGGATTAATTATGCATAATCAATTTGGTCCTTTGGATATTAAAGATACTGGAATTATTCAGCGTTTCAGAACT
GATGAAGTGGAGGCACCATGGGTTAATAATAATGATTCTCATTTAAAATTACCTGATAATTTAATAGCTAAAGGTGCTGA
ATCGGATATTATTAAAAGTTCATATTTAGGTAAAAATGCAGTATTGAAAAGTAGAATTCCGAAAGCTTACAGAATTGCTG
AGATTGATTCCAAAATAAGAAAGTCAAGAACTAAACTTGAAGCCAAATTGCTGTCTGATGTTAAAAAATCAGGTGTAATT
ACTCCTGTATTGTATGATGTTGATTTGGAAAATAAATCTATATTGATGGAAGCTATTGAAGGTAAAATGCTTAAAGAAGT
TATTGATGACAATTTAGCTTATAAAATTGGAGTTGAGATAGCTAAAATACATAGTTTGGATATTATTCATGGGGATATTA
CAACTTCCAATATGATGCTTAGAGGCGGAAAATTAGTATTTTTAGATTTTGGTCTTGGGAGACATTCTGATTTATTTGAA
GATAAGGCAGTTGATTTGCTTGTGTTGAAAAAATCATTGCAAAGTATAGACAACACTACAGCTAGCAAATACTTTGATAA
TGTCTTGGAGGGTTATGCAGAATCATATGGAAAAAATAAAGATAAAATAATTGAAAAAATAAAAGAAATAGAATCTAGAG
GGCGTTATACTCATTAG

Upstream 100 bases:

>100_bases
GATATTATAAAATGTGTGTTTTTGCAAATTTTAAAATAGTCGTGAACTGTATCTTATTTATATTTCAAATGACCAATATT
AAATTAAATTATTTTTTAAG

Downstream 100 bases:

>100_bases
AAAAGTACAGGTTGTGCCGACCTTATTTTTATATATGTGAGAACCTCTTTTTTTTAGTGTATTGAATGTGGGATTGACAC
AAATTTCTAAATCCGTTTGC

Product: O-sialoglycoprotein endopeptidase/protein kinase

Products: NA

Alternate protein names: Glycoprotease

Number of amino acids: Translated: 538; Mature: 538

Protein sequence:

>538_residues
MIVLICLGIEGTAEKTGVGIVDSDGNILAMAGEQLFPEKGGIHPRIAAEHHGYWIPKLIPKAIDEAGISYDDLDLISFSQ
GPGLGPALRIVATSARTLALSLNKPIIGVNHCIGHVEVGKLDTGAVNPVTLYVSGGNSQVISHESGRYRIFGETLDIAAG
NCLDHFGRETGLGHPGGPVIEKLAKKGSYVDLPYVVKGMDFSFSGLLSAALREVKKGTPIEDVCFSLQETAFSMLVEVTE
RALSHTQKDEVMLCGGVSANSRLREMLKVMAEEHGAKFCMPEMKLCGDNGVMIAWLGLIMHNQFGPLDIKDTGIIQRFRT
DEVEAPWVNNNDSHLKLPDNLIAKGAESDIIKSSYLGKNAVLKSRIPKAYRIAEIDSKIRKSRTKLEAKLLSDVKKSGVI
TPVLYDVDLENKSILMEAIEGKMLKEVIDDNLAYKIGVEIAKIHSLDIIHGDITTSNMMLRGGKLVFLDFGLGRHSDLFE
DKAVDLLVLKKSLQSIDNTTASKYFDNVLEGYAESYGKNKDKIIEKIKEIESRGRYTH

Sequences:

>Translated_538_residues
MIVLICLGIEGTAEKTGVGIVDSDGNILAMAGEQLFPEKGGIHPRIAAEHHGYWIPKLIPKAIDEAGISYDDLDLISFSQ
GPGLGPALRIVATSARTLALSLNKPIIGVNHCIGHVEVGKLDTGAVNPVTLYVSGGNSQVISHESGRYRIFGETLDIAAG
NCLDHFGRETGLGHPGGPVIEKLAKKGSYVDLPYVVKGMDFSFSGLLSAALREVKKGTPIEDVCFSLQETAFSMLVEVTE
RALSHTQKDEVMLCGGVSANSRLREMLKVMAEEHGAKFCMPEMKLCGDNGVMIAWLGLIMHNQFGPLDIKDTGIIQRFRT
DEVEAPWVNNNDSHLKLPDNLIAKGAESDIIKSSYLGKNAVLKSRIPKAYRIAEIDSKIRKSRTKLEAKLLSDVKKSGVI
TPVLYDVDLENKSILMEAIEGKMLKEVIDDNLAYKIGVEIAKIHSLDIIHGDITTSNMMLRGGKLVFLDFGLGRHSDLFE
DKAVDLLVLKKSLQSIDNTTASKYFDNVLEGYAESYGKNKDKIIEKIKEIESRGRYTH
>Mature_538_residues
MIVLICLGIEGTAEKTGVGIVDSDGNILAMAGEQLFPEKGGIHPRIAAEHHGYWIPKLIPKAIDEAGISYDDLDLISFSQ
GPGLGPALRIVATSARTLALSLNKPIIGVNHCIGHVEVGKLDTGAVNPVTLYVSGGNSQVISHESGRYRIFGETLDIAAG
NCLDHFGRETGLGHPGGPVIEKLAKKGSYVDLPYVVKGMDFSFSGLLSAALREVKKGTPIEDVCFSLQETAFSMLVEVTE
RALSHTQKDEVMLCGGVSANSRLREMLKVMAEEHGAKFCMPEMKLCGDNGVMIAWLGLIMHNQFGPLDIKDTGIIQRFRT
DEVEAPWVNNNDSHLKLPDNLIAKGAESDIIKSSYLGKNAVLKSRIPKAYRIAEIDSKIRKSRTKLEAKLLSDVKKSGVI
TPVLYDVDLENKSILMEAIEGKMLKEVIDDNLAYKIGVEIAKIHSLDIIHGDITTSNMMLRGGKLVFLDFGLGRHSDLFE
DKAVDLLVLKKSLQSIDNTTASKYFDNVLEGYAESYGKNKDKIIEKIKEIESRGRYTH

Specific function: Could Be A Metalloprotease. [C]

COG id: COG0533

COG function: function code O; Metal-dependent proteases with possible chaperone activity

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 protein kinase domain

Homologues:

Organism=Homo sapiens, GI8923380, Length=331, Percent_Identity=49.2447129909366, Blast_Score=305, Evalue=6e-83,
Organism=Homo sapiens, GI41327715, Length=215, Percent_Identity=34.8837209302326, Blast_Score=127, Evalue=3e-29,
Organism=Homo sapiens, GI116812636, Length=331, Percent_Identity=29.0030211480363, Blast_Score=120, Evalue=3e-27,
Organism=Escherichia coli, GI1789445, Length=342, Percent_Identity=33.3333333333333, Blast_Score=162, Evalue=4e-41,
Organism=Caenorhabditis elegans, GI71995670, Length=337, Percent_Identity=48.0712166172107, Blast_Score=292, Evalue=3e-79,
Organism=Caenorhabditis elegans, GI17557464, Length=374, Percent_Identity=28.0748663101604, Blast_Score=112, Evalue=5e-25,
Organism=Saccharomyces cerevisiae, GI6322891, Length=368, Percent_Identity=42.9347826086957, Blast_Score=277, Evalue=3e-75,
Organism=Saccharomyces cerevisiae, GI6320099, Length=339, Percent_Identity=29.7935103244838, Blast_Score=119, Evalue=2e-27,
Organism=Saccharomyces cerevisiae, GI6321701, Length=225, Percent_Identity=32, Blast_Score=91, Evalue=5e-19,
Organism=Drosophila melanogaster, GI21357207, Length=345, Percent_Identity=47.2463768115942, Blast_Score=305, Evalue=4e-83,
Organism=Drosophila melanogaster, GI20129063, Length=334, Percent_Identity=29.0419161676647, Blast_Score=117, Evalue=2e-26,
Organism=Drosophila melanogaster, GI24658177, Length=215, Percent_Identity=31.1627906976744, Blast_Score=108, Evalue=1e-23,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): GCP_METS3 (A5UMH5)

Other databases:

- EMBL:   CP000678
- RefSeq:   YP_001273771.1
- ProteinModelPortal:   A5UMH5
- SMR:   A5UMH5
- STRING:   A5UMH5
- MEROPS:   M22.003
- GeneID:   5216853
- GenomeReviews:   CP000678_GR
- KEGG:   msi:Msm_1198
- eggNOG:   arNOG04080
- HOGENOM:   HBG304663
- OMA:   GNCLDQF
- ProtClustDB:   PRK09605
- GO:   GO:0006508
- HAMAP:   MF_01447
- InterPro:   IPR022449
- InterPro:   IPR022495
- InterPro:   IPR011009
- InterPro:   IPR009220
- InterPro:   IPR000905
- InterPro:   IPR017860
- InterPro:   IPR017861
- InterPro:   IPR000719
- InterPro:   IPR017442
- InterPro:   IPR008266
- PANTHER:   PTHR11735
- PIRSF:   PIRSF036401
- PRINTS:   PR00789
- TIGRFAMs:   TIGR03724
- TIGRFAMs:   TIGR03722
- TIGRFAMs:   TIGR00329

Pfam domain/function: PF00814 Peptidase_M22; PF00069 Pkinase; SSF56112 Kinase_like

EC number: =3.4.24.57

Molecular weight: Translated: 58786; Mature: 58786

Theoretical pI: Translated: 6.52; Mature: 6.52

Prosite motif: PS01016 GLYCOPROTEASE; PS50011 PROTEIN_KINASE_DOM; PS00109 PROTEIN_KINASE_TYR

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.3 %Cys     (Translated Protein)
2.8 %Met     (Translated Protein)
4.1 %Cys+Met (Translated Protein)
1.3 %Cys     (Mature Protein)
2.8 %Met     (Mature Protein)
4.1 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MIVLICLGIEGTAEKTGVGIVDSDGNILAMAGEQLFPEKGGIHPRIAAEHHGYWIPKLIP
CEEEEEECCCCCCCCCCCEEEECCCCEEEECCCHHCCCCCCCCCCEECCCCCEECHHHHH
KAIDEAGISYDDLDLISFSQGPGLGPALRIVATSARTLALSLNKPIIGVNHCIGHVEVGK
HHHHHHCCCCCCCEEEEECCCCCCCHHHHEEEECCEEEEEECCCCEEEHHHCCCCEEECC
LDTGAVNPVTLYVSGGNSQVISHESGRYRIFGETLDIAAGNCLDHFGRETGLGHPGGPVI
CCCCCCCCEEEEEECCCCEEEECCCCCEEEECCEECCCCCHHHHHCCHHCCCCCCCCHHH
EKLAKKGSYVDLPYVVKGMDFSFSGLLSAALREVKKGTPIEDVCFSLQETAFSMLVEVTE
HHHHHCCCEECCCCEEECCCCCHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHH
RALSHTQKDEVMLCGGVSANSRLREMLKVMAEEHGAKFCMPEMKLCGDNGVMIAWLGLIM
HHHHCCCCCCEEEECCCCCCHHHHHHHHHHHHHCCCCCCCCCHHHCCCCCHHHHHHHHHH
HNQFGPLDIKDTGIIQRFRTDEVEAPWVNNNDSHLKLPDNLIAKGAESDIIKSSYLGKNA
HCCCCCCCCCCCHHHHHHCCCCCCCCCCCCCCCEEECCHHHHHCCCCHHHHHHHHCCCHH
VLKSRIPKAYRIAEIDSKIRKSRTKLEAKLLSDVKKSGVITPVLYDVDLENKSILMEAIE
HHHHHCCCCEEHHHHHHHHHHHHHHHHHHHHHHHHHCCCEEEEEEEECCCCHHHHHHHHH
GKMLKEVIDDNLAYKIGVEIAKIHSLDIIHGDITTSNMMLRGGKLVFLDFGLGRHSDLFE
HHHHHHHHCCCCEEEECCEEEEEEEEEEEECCCCCCCEEEECCEEEEEEECCCCCCCHHH
DKAVDLLVLKKSLQSIDNTTASKYFDNVLEGYAESYGKNKDKIIEKIKEIESRGRYTH
HHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHCCCCCC
>Mature Secondary Structure
MIVLICLGIEGTAEKTGVGIVDSDGNILAMAGEQLFPEKGGIHPRIAAEHHGYWIPKLIP
CEEEEEECCCCCCCCCCCEEEECCCCEEEECCCHHCCCCCCCCCCEECCCCCEECHHHHH
KAIDEAGISYDDLDLISFSQGPGLGPALRIVATSARTLALSLNKPIIGVNHCIGHVEVGK
HHHHHHCCCCCCCEEEEECCCCCCCHHHHEEEECCEEEEEECCCCEEEHHHCCCCEEECC
LDTGAVNPVTLYVSGGNSQVISHESGRYRIFGETLDIAAGNCLDHFGRETGLGHPGGPVI
CCCCCCCCEEEEEECCCCEEEECCCCCEEEECCEECCCCCHHHHHCCHHCCCCCCCCHHH
EKLAKKGSYVDLPYVVKGMDFSFSGLLSAALREVKKGTPIEDVCFSLQETAFSMLVEVTE
HHHHHCCCEECCCCEEECCCCCHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHH
RALSHTQKDEVMLCGGVSANSRLREMLKVMAEEHGAKFCMPEMKLCGDNGVMIAWLGLIM
HHHHCCCCCCEEEECCCCCCHHHHHHHHHHHHHCCCCCCCCCHHHCCCCCHHHHHHHHHH
HNQFGPLDIKDTGIIQRFRTDEVEAPWVNNNDSHLKLPDNLIAKGAESDIIKSSYLGKNA
HCCCCCCCCCCCHHHHHHCCCCCCCCCCCCCCCEEECCHHHHHCCCCHHHHHHHHCCCHH
VLKSRIPKAYRIAEIDSKIRKSRTKLEAKLLSDVKKSGVITPVLYDVDLENKSILMEAIE
HHHHHCCCCEEHHHHHHHHHHHHHHHHHHHHHHHHHCCCEEEEEEEECCCCHHHHHHHHH
GKMLKEVIDDNLAYKIGVEIAKIHSLDIIHGDITTSNMMLRGGKLVFLDFGLGRHSDLFE
HHHHHHHHCCCCEEEECCEEEEEEEEEEEECCCCCCCEEEECCEEEEEEECCCCCCCHHH
DKAVDLLVLKKSLQSIDNTTASKYFDNVLEGYAESYGKNKDKIIEKIKEIESRGRYTH
HHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA