| Definition | Polaromonas sp. JS666 chromosome, complete genome. |
|---|---|
| Accession | NC_007948 |
| Length | 5,200,264 |
Click here to switch to the map view.
The map label for this gene is yidJ [C]
Identifier: 91789296
GI number: 91789296
Start: 3641671
End: 3643206
Strand: Direct
Name: yidJ [C]
Synonym: Bpro_3441
Alternate gene names: 91789296
Gene position: 3641671-3643206 (Clockwise)
Preceding gene: 91789295
Following gene: 91789299
Centisome position: 70.03
GC content: 63.54
Gene sequence:
>1536_bases ATGAAGCGACCCAACATACTGCTCATCACCACCGACCAGCACCGGGGTGACTGCCTGGGCTTTGCAGGCCGCAAGGTCAA GACCCCGCACATCGACGAAATGGCCAGGACGGGCACGCACTTCACCTCGTGCATCACGCCGAACATCGTGTGCCAGCCCT CTCGCGCCTCCATCCTGACCGGGTTGTTGCCGCTGACGCACGGCGTATGCGACAACGGCATTGACCTGGATGAGGCGAGA GGCGAAGCGGGCTTTGCCGGCACACTGGCAAGCAGCGGTTATTCGACAGGCTTTATCGGCAAGGCGCATTTCTCGACCCA CCACACGTTTGCAAAAACCGGCCGCCCCGAATGCCAGTTCAGCGAGGCCGACTACGGCCCCGCGTGGTACGGCCCATACA TGGGCTTTGAACATGTGGAGCTTGCCGTGGAAGGGCACAACTACTGGTTGCCCACCCCGCTGCCGGGCGGGCTGCACCAT TCGCGCTGGTACTACGGCGATGGTCTGGGCGAGATGCGCAACAGGCTTTACCAGCAAGACATGGGGCCACCCAGTGGCGC GCCGCAAACCTTCAATTCCGCCCTGCCCAGCGCGTGGCACAACTCCACCTGGATAGGCGACCGGACGATCGAGTTCATGC GCAAACATGCAGGCGAGGCCGCAAAACGCTTCTGCCTGTGGGCCTCGTTTCCAGATCCGCATCACCCCTTTGATTGCCCG GAGCCATGGTCACGGCTTCACCACCCGGATGAGGTCGACCTGCCGGCGCACCGGACCACCGACTTCGAGCGCCGGCCCTG GTGGCACAAGGCCAGCATGGACAGCAAGCCCGTCGGCGATGCGGCCGTGCAGGCCCTGCGGCAAAACTTCTCGCGCATGC CTACACCGGCCGAGCAGCAACTGCGCAACATCACCGCTAACTACTACGGCATGATTTCGCTGGTGGACCACCAGGTGGGC CGCATCCAGACCGCGTTGCAGCAACTGGGCCTGGACGGCAACACCCTCGTGATCTTCACCTCTGATCACGGCGAGTGGCT GGGTGACCACGGGCTGATGCTCAAGGGCCCGATCCCTTACGAAGGTGTCCTGCGCGTGGGCATGGTTGTCAACGGCCCGC AGGTCCAGGCCGGCCAGGTGCGGCATGAGCCGGTATCAACGCTCGACCTGGCCGCCACCTTTGCGGACTATGCAACGGCC ACCGCGCTGGCGCCCCTGCACGGCCAGAGCCTGCGGCCTTTGTTGGAAGGCGGGCAACAGACACGCGACTTCGCATTGAG CGAATGGAACGTGGCCGCATCGCGCTGCGGTTTGGAACTGCAACTGCGAACCGTGCGCACCGAAAACTGGAAACTCACCC TCGAGCAAAACTCCGGCGCAGGCGAGATGTACTGCCTGTCCGAAGATCCCAATGAGATGGACAACCTGTTCGACGACCCG GGCTATACGGCAAAGCGCAAGGAGCTCAGTGACATGATCGCATCGCGCCCCCGCGACCAGTTGGCCCAAGCGCCCGCGCC TTCGGGCATTGCATAG
Upstream 100 bases:
>100_bases TGACGTTTGAAGATCCATCCACCCTTGCCAAACGCATCGATGAGGACACCAAACGTTATGCGCCCGTGGTGGCCAAGCTG AAGGAACAAAGCGCCAAGCC
Downstream 100 bases:
>100_bases CGTTGCGGTGTGACACTACTATTTTAATAGCCCGTACAGCCCACCTCTATTTGATTTCAGGCCTATTTGCTTTTCACAAA TGGTATTTATTAGGCCACTT
Product: sulfatase
Products: NA
Alternate protein names: Cys-type sulfatase [H]
Number of amino acids: Translated: 511; Mature: 511
Protein sequence:
>511_residues MKRPNILLITTDQHRGDCLGFAGRKVKTPHIDEMARTGTHFTSCITPNIVCQPSRASILTGLLPLTHGVCDNGIDLDEAR GEAGFAGTLASSGYSTGFIGKAHFSTHHTFAKTGRPECQFSEADYGPAWYGPYMGFEHVELAVEGHNYWLPTPLPGGLHH SRWYYGDGLGEMRNRLYQQDMGPPSGAPQTFNSALPSAWHNSTWIGDRTIEFMRKHAGEAAKRFCLWASFPDPHHPFDCP EPWSRLHHPDEVDLPAHRTTDFERRPWWHKASMDSKPVGDAAVQALRQNFSRMPTPAEQQLRNITANYYGMISLVDHQVG RIQTALQQLGLDGNTLVIFTSDHGEWLGDHGLMLKGPIPYEGVLRVGMVVNGPQVQAGQVRHEPVSTLDLAATFADYATA TALAPLHGQSLRPLLEGGQQTRDFALSEWNVAASRCGLELQLRTVRTENWKLTLEQNSGAGEMYCLSEDPNEMDNLFDDP GYTAKRKELSDMIASRPRDQLAQAPAPSGIA
Sequences:
>Translated_511_residues MKRPNILLITTDQHRGDCLGFAGRKVKTPHIDEMARTGTHFTSCITPNIVCQPSRASILTGLLPLTHGVCDNGIDLDEAR GEAGFAGTLASSGYSTGFIGKAHFSTHHTFAKTGRPECQFSEADYGPAWYGPYMGFEHVELAVEGHNYWLPTPLPGGLHH SRWYYGDGLGEMRNRLYQQDMGPPSGAPQTFNSALPSAWHNSTWIGDRTIEFMRKHAGEAAKRFCLWASFPDPHHPFDCP EPWSRLHHPDEVDLPAHRTTDFERRPWWHKASMDSKPVGDAAVQALRQNFSRMPTPAEQQLRNITANYYGMISLVDHQVG RIQTALQQLGLDGNTLVIFTSDHGEWLGDHGLMLKGPIPYEGVLRVGMVVNGPQVQAGQVRHEPVSTLDLAATFADYATA TALAPLHGQSLRPLLEGGQQTRDFALSEWNVAASRCGLELQLRTVRTENWKLTLEQNSGAGEMYCLSEDPNEMDNLFDDP GYTAKRKELSDMIASRPRDQLAQAPAPSGIA >Mature_511_residues MKRPNILLITTDQHRGDCLGFAGRKVKTPHIDEMARTGTHFTSCITPNIVCQPSRASILTGLLPLTHGVCDNGIDLDEAR GEAGFAGTLASSGYSTGFIGKAHFSTHHTFAKTGRPECQFSEADYGPAWYGPYMGFEHVELAVEGHNYWLPTPLPGGLHH SRWYYGDGLGEMRNRLYQQDMGPPSGAPQTFNSALPSAWHNSTWIGDRTIEFMRKHAGEAAKRFCLWASFPDPHHPFDCP EPWSRLHHPDEVDLPAHRTTDFERRPWWHKASMDSKPVGDAAVQALRQNFSRMPTPAEQQLRNITANYYGMISLVDHQVG RIQTALQQLGLDGNTLVIFTSDHGEWLGDHGLMLKGPIPYEGVLRVGMVVNGPQVQAGQVRHEPVSTLDLAATFADYATA TALAPLHGQSLRPLLEGGQQTRDFALSEWNVAASRCGLELQLRTVRTENWKLTLEQNSGAGEMYCLSEDPNEMDNLFDDP GYTAKRKELSDMIASRPRDQLAQAPAPSGIA
Specific function: Has sulfatase activity toward para-nitrophenyl sulfate, which is increased in presence of calcium ion [H]
COG id: COG3119
COG function: function code P; Arylsulfatase A and related enzymes
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the sulfatase family [H]
Homologues:
Organism=Homo sapiens, GI39930577, Length=511, Percent_Identity=24.0704500978474, Blast_Score=101, Evalue=2e-21, Organism=Homo sapiens, GI240255483, Length=437, Percent_Identity=25.1716247139588, Blast_Score=91, Evalue=2e-18, Organism=Homo sapiens, GI29789100, Length=437, Percent_Identity=25.1716247139588, Blast_Score=91, Evalue=2e-18, Organism=Homo sapiens, GI240255478, Length=437, Percent_Identity=25.1716247139588, Blast_Score=91, Evalue=2e-18, Organism=Homo sapiens, GI4557659, Length=145, Percent_Identity=32.4137931034483, Blast_Score=70, Evalue=6e-12, Organism=Homo sapiens, GI262118210, Length=145, Percent_Identity=32.4137931034483, Blast_Score=69, Evalue=1e-11, Organism=Homo sapiens, GI31742482, Length=111, Percent_Identity=36.036036036036, Blast_Score=67, Evalue=3e-11, Organism=Escherichia coli, GI1790112, Length=499, Percent_Identity=26.8537074148297, Blast_Score=148, Evalue=1e-36, Organism=Caenorhabditis elegans, GI17568795, Length=419, Percent_Identity=25.5369928400955, Blast_Score=88, Evalue=1e-17, Organism=Drosophila melanogaster, GI24647401, Length=487, Percent_Identity=24.2299794661191, Blast_Score=113, Evalue=2e-25,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR017849 - InterPro: IPR017850 - InterPro: IPR000917 [H]
Pfam domain/function: PF00884 Sulfatase [H]
EC number: =3.1.6.1 [H]
Molecular weight: Translated: 56570; Mature: 56570
Theoretical pI: Translated: 6.44; Mature: 6.44
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.8 %Cys (Translated Protein) 2.7 %Met (Translated Protein) 4.5 %Cys+Met (Translated Protein) 1.8 %Cys (Mature Protein) 2.7 %Met (Mature Protein) 4.5 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MKRPNILLITTDQHRGDCLGFAGRKVKTPHIDEMARTGTHFTSCITPNIVCQPSRASILT CCCCCEEEEECCCCCCCEECCCCCCCCCCCHHHHHHCCCHHHHHCCCCEEECCCHHHHHH GLLPLTHGVCDNGIDLDEARGEAGFAGTLASSGYSTGFIGKAHFSTHHTFAKTGRPECQF HHHHHHHCCCCCCCCHHHHCCCCCCEEHHHCCCCCCCCEEECCCCCCCHHHHCCCCCCEE SEADYGPAWYGPYMGFEHVELAVEGHNYWLPTPLPGGLHHSRWYYGDGLGEMRNRLYQQD CCCCCCCCCCCCCCCCEEEEEEEECCCEECCCCCCCCCCCCCEEECCCHHHHHHHHHHHH MGPPSGAPQTFNSALPSAWHNSTWIGDRTIEFMRKHAGEAAKRFCLWASFPDPHHPFDCP CCCCCCCCHHHHHHCCCCCCCCCCCCHHHHHHHHHHHHHHHHHEEEEECCCCCCCCCCCC EPWSRLHHPDEVDLPAHRTTDFERRPWWHKASMDSKPVGDAAVQALRQNFSRMPTPAEQQ CHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHCCCCHHHH LRNITANYYGMISLVDHQVGRIQTALQQLGLDGNTLVIFTSDHGEWLGDHGLMLKGPIPY HHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCEEEEEECCCCCCCCCCCEEEECCCCH EGVLRVGMVVNGPQVQAGQVRHEPVSTLDLAATFADYATATALAPLHGQSLRPLLEGGQQ HHHEEEEEEECCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHCCCCCCCCCCHHHHCCCH TRDFALSEWNVAASRCGLELQLRTVRTENWKLTLEQNSGAGEMYCLSEDPNEMDNLFDDP HHHHHHHHCHHHHHHCCCEEEEEEEECCCEEEEEEECCCCCEEEEECCCCHHHHHHCCCC GYTAKRKELSDMIASRPRDQLAQAPAPSGIA CCCHHHHHHHHHHHCCCHHHHHCCCCCCCCC >Mature Secondary Structure MKRPNILLITTDQHRGDCLGFAGRKVKTPHIDEMARTGTHFTSCITPNIVCQPSRASILT CCCCCEEEEECCCCCCCEECCCCCCCCCCCHHHHHHCCCHHHHHCCCCEEECCCHHHHHH GLLPLTHGVCDNGIDLDEARGEAGFAGTLASSGYSTGFIGKAHFSTHHTFAKTGRPECQF HHHHHHHCCCCCCCCHHHHCCCCCCEEHHHCCCCCCCCEEECCCCCCCHHHHCCCCCCEE SEADYGPAWYGPYMGFEHVELAVEGHNYWLPTPLPGGLHHSRWYYGDGLGEMRNRLYQQD CCCCCCCCCCCCCCCCEEEEEEEECCCEECCCCCCCCCCCCCEEECCCHHHHHHHHHHHH MGPPSGAPQTFNSALPSAWHNSTWIGDRTIEFMRKHAGEAAKRFCLWASFPDPHHPFDCP CCCCCCCCHHHHHHCCCCCCCCCCCCHHHHHHHHHHHHHHHHHEEEEECCCCCCCCCCCC EPWSRLHHPDEVDLPAHRTTDFERRPWWHKASMDSKPVGDAAVQALRQNFSRMPTPAEQQ CHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHCCCCHHHH LRNITANYYGMISLVDHQVGRIQTALQQLGLDGNTLVIFTSDHGEWLGDHGLMLKGPIPY HHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCEEEEEECCCCCCCCCCCEEEECCCCH EGVLRVGMVVNGPQVQAGQVRHEPVSTLDLAATFADYATATALAPLHGQSLRPLLEGGQQ HHHEEEEEEECCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHCCCCCCCCCCHHHHCCCH TRDFALSEWNVAASRCGLELQLRTVRTENWKLTLEQNSGAGEMYCLSEDPNEMDNLFDDP HHHHHHHHCHHHHHHCCCEEEEEEEECCCEEEEEEECCCCCEEEEECCCCHHHHHHCCCC GYTAKRKELSDMIASRPRDQLAQAPAPSGIA CCCHHHHHHHHHHHCCCHHHHHCCCCCCCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: NA