Definition Flavobacterium johnsoniae UW101 chromosome, complete genome.
Accession NC_009441
Length 6,096,872

Click here to switch to the map view.

The map label for this gene is atsA [H]

Identifier: 146301027

GI number: 146301027

Start: 3923481

End: 3925880

Strand: Reverse

Name: atsA [H]

Synonym: Fjoh_3283

Alternate gene names: 146301027

Gene position: 3925880-3923481 (Counterclockwise)

Preceding gene: 146301028

Following gene: 146301026

Centisome position: 64.39

GC content: 38.21

Gene sequence:

>2400_bases
ATGAAACAACTATTTAAACTTTTGATATTTTTGTTCTGTTCCTTTTTAATGGCACAGAATCCTCCTAAAAAACAGGAAGA
AAAGAAATTTGGCGGTGATATTAAACTCGATATTCGGGATTCAAAAGGCGACTGGCCGGCATTTCTGGAGACAAAAGCTC
CAAAAGATGCCCCAAACGTACTTATTATTTTATATGATGATACCGGTTTTGCTGCATGGTCACCTTATGGGGGGCGTATC
AATATGCCCACTATGGATGAACTGGCAAAAAACGGATTAACGTATACGCAATGGCATACTACATCGGTATGTTCGCCTAC
ACGTTCTACACTTTTAACAGGGCGTAATCATCATCAAAACGGATTTGGTTCTATATCAGAATCTGCGGTTGGATTTCCGG
GCTACAGCGGGCATATCCCAAAAGAAAATGCTACACTTGCTACTGTATTGCGAGAAGCCGGATGGTCGACTTTTTGGATT
GGTAAAAACCATAATGTTCCTGTAGATGCACTTGATATGGCTTCTTCTAAAGAACGCTGGCCTCTTGGACTTGGATTTGA
TCGTTTTTACGGATTTATTGGAGGAGAAACTAACCAGTGGTACCCAAGTCTTATAGAAGACAATCATTTTATAGAACAGC
CTTCTCAACCAGAAAATGGTTATCATTTAAGCAAAGATTTGGCAGATAAAGCAATTGCGTATATTCAGGATTCAAAACAA
TCAAAACCAGATAAGCCTTGGTTTATGTGGTACAATCCGGGAGCAAATCATGCACCGCATCATGCACCAGCCGATTATAT
TGCGAAATACAAAGGAAAATTTGACGATGGTTATGAAGCTTACAGAGACTGGGTTTTAAAACGTATGATCGATAAAGGAA
TTCTGCCAAAAGGAACAAAAATGACACCTTTAAATCCTATGCCGAAAGGTAAATTTGCTGAAAGCGATATGGTAAAACCA
TGGAATAGTCTGACTGCCGATGAAAAAAAATTGTTCAGCCGTATGGCCGAAGTGTATGCGGCTTATTCAGAATTTACAGA
TGCTGAAGTAGGGCGTGTAATTAAATATCTAAAAGATTCAGGTCAGTTTGATAATACTTTGATTATGTATTGTGCTGATA
ATGGTGCTTCTGCAGAAGGTTCGCCAAATGGTTCGGTAAACGAGAATAATTTCTTTAATGCCTATCCGGATGACATGAGT
GTTAATTTAAGCATGATTGATAAACTAGGTTCAGAAGATACTTACAATCATTATCCAACAGGATGGGCAGCTGCTTTTTC
GACACCATTTAAAATGTTTAAAAGATATTCTGGCTACAGCGGAGGGACTGCTGATCCTCTTGTAATCTGCTGGCCAAAAG
GAATTAAAGCCAAAGGTGAATTAAGAAGTCAGTATTACCACTGTACCGATATTGTACCTACAATATTAGAAGCCTGCGGT
TTGACGATGCCGGATGTAGTAGATGGTGTCAAGCAGACACCCCTTGCAGGTGTTTCTATGATAAGCAGTTTTAATAATGC
AAAAGCGCCAACTGCTAAAAAAGTACAATATTATGAAATGGTAGGCACAAGAGGAATCTGGAAAGACGGCTGGAAAGCTA
CAGCTGTTCATGGGGCTTTACCCGTAAATATTGGAAATTTTGATAAAGATCAATGGGAGTTGTATAATGTAGATGCTGAT
CGTTCAGAGTCTACAGATCTTGCAGTAAAATATCCTGATAAAGTAAAAGAACTGCAACAAATTTGGATGGACGAAGCAAA
AAAATACCATGTACTGCCGCTTAATGATCTTTCTATTCCTGAATTTCACAAATTAGAATATCATAAAGAAGTTCCGGCTG
ATGGTCGATTTATTTATTATCCGGGAACCACAGAAGTTCCTGAAGCTTCTGCCGCACCAACTCTTGGACGTTCATTTAAA
ATTCTGGCCGAAGTAGATTTTACTAAAGATTCAAAAGGAGTTATTGTATCTCAGGGATCACGTTTTGGCGGTTATAGTTT
GTTTGCAAAAGACGGAAAACTGACTTATGTCTATAATTTCCTCGGTCTTGCGCCAGAACAGGTTTTAAGCACTTCAATTC
CTTCTAGTGGGAAACATATTGTAGGTGTTGAATTTATAAAAGAAAAAATGAGTGACAAAAACGAGACTTTAGGAAAGATG
AGGTTGTATTTAGACAATAAAGTAGTTGACGAAAAACCTTTTCGAACTCAGGCAGGACATTATTCACTTTCAGGAGAAGG
TTTATGTGTAGGCCGTGACAGCGGTGATCCGGTAAGTAAACAATATAAAGCCAAATTCGATTTTACTGGCGGTAAAATTG
CAAAAGTAGTTTATGATGTTAGTAATGATGCTTATCAGAATGTTGAGAACGAATTTAAAGTAAAAATGGCAAAAGAGTAA

Upstream 100 bases:

>100_bases
TATTTCCGAATTTACGGACCAGAAAAAGACGCATTTAACGGAAGCTGGAAACCAGGTGACTTTGAAGAAGTAAAGTAACA
CTTTAAACCATCATACTATC

Downstream 100 bases:

>100_bases
AATGTGATTTCATTAGAGAAATATTTAAACTTCAAGACTATGTCCTTACCTGACGAACTATATAATGTCAAATTTGCAGA
ATATTTTGAATCAATGAGAA

Product: sulfatase

Products: NA

Alternate protein names: AS; Aryl-sulfate sulphohydrolase [H]

Number of amino acids: Translated: 799; Mature: 799

Protein sequence:

>799_residues
MKQLFKLLIFLFCSFLMAQNPPKKQEEKKFGGDIKLDIRDSKGDWPAFLETKAPKDAPNVLIILYDDTGFAAWSPYGGRI
NMPTMDELAKNGLTYTQWHTTSVCSPTRSTLLTGRNHHQNGFGSISESAVGFPGYSGHIPKENATLATVLREAGWSTFWI
GKNHNVPVDALDMASSKERWPLGLGFDRFYGFIGGETNQWYPSLIEDNHFIEQPSQPENGYHLSKDLADKAIAYIQDSKQ
SKPDKPWFMWYNPGANHAPHHAPADYIAKYKGKFDDGYEAYRDWVLKRMIDKGILPKGTKMTPLNPMPKGKFAESDMVKP
WNSLTADEKKLFSRMAEVYAAYSEFTDAEVGRVIKYLKDSGQFDNTLIMYCADNGASAEGSPNGSVNENNFFNAYPDDMS
VNLSMIDKLGSEDTYNHYPTGWAAAFSTPFKMFKRYSGYSGGTADPLVICWPKGIKAKGELRSQYYHCTDIVPTILEACG
LTMPDVVDGVKQTPLAGVSMISSFNNAKAPTAKKVQYYEMVGTRGIWKDGWKATAVHGALPVNIGNFDKDQWELYNVDAD
RSESTDLAVKYPDKVKELQQIWMDEAKKYHVLPLNDLSIPEFHKLEYHKEVPADGRFIYYPGTTEVPEASAAPTLGRSFK
ILAEVDFTKDSKGVIVSQGSRFGGYSLFAKDGKLTYVYNFLGLAPEQVLSTSIPSSGKHIVGVEFIKEKMSDKNETLGKM
RLYLDNKVVDEKPFRTQAGHYSLSGEGLCVGRDSGDPVSKQYKAKFDFTGGKIAKVVYDVSNDAYQNVENEFKVKMAKE

Sequences:

>Translated_799_residues
MKQLFKLLIFLFCSFLMAQNPPKKQEEKKFGGDIKLDIRDSKGDWPAFLETKAPKDAPNVLIILYDDTGFAAWSPYGGRI
NMPTMDELAKNGLTYTQWHTTSVCSPTRSTLLTGRNHHQNGFGSISESAVGFPGYSGHIPKENATLATVLREAGWSTFWI
GKNHNVPVDALDMASSKERWPLGLGFDRFYGFIGGETNQWYPSLIEDNHFIEQPSQPENGYHLSKDLADKAIAYIQDSKQ
SKPDKPWFMWYNPGANHAPHHAPADYIAKYKGKFDDGYEAYRDWVLKRMIDKGILPKGTKMTPLNPMPKGKFAESDMVKP
WNSLTADEKKLFSRMAEVYAAYSEFTDAEVGRVIKYLKDSGQFDNTLIMYCADNGASAEGSPNGSVNENNFFNAYPDDMS
VNLSMIDKLGSEDTYNHYPTGWAAAFSTPFKMFKRYSGYSGGTADPLVICWPKGIKAKGELRSQYYHCTDIVPTILEACG
LTMPDVVDGVKQTPLAGVSMISSFNNAKAPTAKKVQYYEMVGTRGIWKDGWKATAVHGALPVNIGNFDKDQWELYNVDAD
RSESTDLAVKYPDKVKELQQIWMDEAKKYHVLPLNDLSIPEFHKLEYHKEVPADGRFIYYPGTTEVPEASAAPTLGRSFK
ILAEVDFTKDSKGVIVSQGSRFGGYSLFAKDGKLTYVYNFLGLAPEQVLSTSIPSSGKHIVGVEFIKEKMSDKNETLGKM
RLYLDNKVVDEKPFRTQAGHYSLSGEGLCVGRDSGDPVSKQYKAKFDFTGGKIAKVVYDVSNDAYQNVENEFKVKMAKE
>Mature_799_residues
MKQLFKLLIFLFCSFLMAQNPPKKQEEKKFGGDIKLDIRDSKGDWPAFLETKAPKDAPNVLIILYDDTGFAAWSPYGGRI
NMPTMDELAKNGLTYTQWHTTSVCSPTRSTLLTGRNHHQNGFGSISESAVGFPGYSGHIPKENATLATVLREAGWSTFWI
GKNHNVPVDALDMASSKERWPLGLGFDRFYGFIGGETNQWYPSLIEDNHFIEQPSQPENGYHLSKDLADKAIAYIQDSKQ
SKPDKPWFMWYNPGANHAPHHAPADYIAKYKGKFDDGYEAYRDWVLKRMIDKGILPKGTKMTPLNPMPKGKFAESDMVKP
WNSLTADEKKLFSRMAEVYAAYSEFTDAEVGRVIKYLKDSGQFDNTLIMYCADNGASAEGSPNGSVNENNFFNAYPDDMS
VNLSMIDKLGSEDTYNHYPTGWAAAFSTPFKMFKRYSGYSGGTADPLVICWPKGIKAKGELRSQYYHCTDIVPTILEACG
LTMPDVVDGVKQTPLAGVSMISSFNNAKAPTAKKVQYYEMVGTRGIWKDGWKATAVHGALPVNIGNFDKDQWELYNVDAD
RSESTDLAVKYPDKVKELQQIWMDEAKKYHVLPLNDLSIPEFHKLEYHKEVPADGRFIYYPGTTEVPEASAAPTLGRSFK
ILAEVDFTKDSKGVIVSQGSRFGGYSLFAKDGKLTYVYNFLGLAPEQVLSTSIPSSGKHIVGVEFIKEKMSDKNETLGKM
RLYLDNKVVDEKPFRTQAGHYSLSGEGLCVGRDSGDPVSKQYKAKFDFTGGKIAKVVYDVSNDAYQNVENEFKVKMAKE

Specific function: Unknown

COG id: COG3119

COG function: function code P; Arylsulfatase A and related enzymes

Gene ontology:

Cell location: Cytoplasm (Potential) [H]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the sulfatase family [H]

Homologues:

Organism=Homo sapiens, GI38569407, Length=225, Percent_Identity=27.5555555555556, Blast_Score=82, Evalue=1e-15,
Organism=Homo sapiens, GI157266309, Length=342, Percent_Identity=26.9005847953216, Blast_Score=82, Evalue=2e-15,
Organism=Homo sapiens, GI38569405, Length=225, Percent_Identity=27.5555555555556, Blast_Score=81, Evalue=3e-15,
Organism=Homo sapiens, GI109389362, Length=237, Percent_Identity=29.1139240506329, Blast_Score=80, Evalue=8e-15,
Organism=Homo sapiens, GI59797060, Length=220, Percent_Identity=29.0909090909091, Blast_Score=79, Evalue=2e-14,
Organism=Homo sapiens, GI71852586, Length=162, Percent_Identity=33.9506172839506, Blast_Score=76, Evalue=1e-13,
Organism=Homo sapiens, GI71852584, Length=162, Percent_Identity=33.9506172839506, Blast_Score=75, Evalue=3e-13,
Organism=Homo sapiens, GI31742482, Length=351, Percent_Identity=25.9259259259259, Blast_Score=74, Evalue=4e-13,
Organism=Homo sapiens, GI53831991, Length=141, Percent_Identity=34.7517730496454, Blast_Score=74, Evalue=7e-13,
Organism=Homo sapiens, GI4503899, Length=252, Percent_Identity=25.7936507936508, Blast_Score=70, Evalue=8e-12,
Organism=Escherichia coli, GI1790233, Length=488, Percent_Identity=26.4344262295082, Blast_Score=84, Evalue=4e-17,
Organism=Caenorhabditis elegans, GI17559078, Length=221, Percent_Identity=25.7918552036199, Blast_Score=68, Evalue=2e-11,
Organism=Drosophila melanogaster, GI281366397, Length=236, Percent_Identity=26.6949152542373, Blast_Score=80, Evalue=5e-15,
Organism=Drosophila melanogaster, GI281366395, Length=236, Percent_Identity=26.6949152542373, Blast_Score=80, Evalue=5e-15,
Organism=Drosophila melanogaster, GI24666163, Length=236, Percent_Identity=26.6949152542373, Blast_Score=80, Evalue=5e-15,
Organism=Drosophila melanogaster, GI24666175, Length=243, Percent_Identity=27.9835390946502, Blast_Score=71, Evalue=3e-12,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR017849
- InterPro:   IPR017850
- InterPro:   IPR000917 [H]

Pfam domain/function: PF00884 Sulfatase [H]

EC number: =3.1.6.1 [H]

Molecular weight: Translated: 89389; Mature: 89389

Theoretical pI: Translated: 6.90; Mature: 6.90

Prosite motif: PS00523 SULFATASE_1

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.9 %Cys     (Translated Protein)
2.8 %Met     (Translated Protein)
3.6 %Cys+Met (Translated Protein)
0.9 %Cys     (Mature Protein)
2.8 %Met     (Mature Protein)
3.6 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKQLFKLLIFLFCSFLMAQNPPKKQEEKKFGGDIKLDIRDSKGDWPAFLETKAPKDAPNV
CHHHHHHHHHHHHHHHHHCCCCCHHHHHHCCCEEEEEEECCCCCCCEEEECCCCCCCCCE
LIILYDDTGFAAWSPYGGRINMPTMDELAKNGLTYTQWHTTSVCSPTRSTLLTGRNHHQN
EEEEECCCCCEEECCCCCEECCCCHHHHHHCCCEEEEECCCCCCCCCHHHHCCCCCCCCC
GFGSISESAVGFPGYSGHIPKENATLATVLREAGWSTFWIGKNHNVPVDALDMASSKERW
CCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHCCCCEEEECCCCCCCCHHHHCCCCCCCC
PLGLGFDRFYGFIGGETNQWYPSLIEDNHFIEQPSQPENGYHLSKDLADKAIAYIQDSKQ
CCCCCHHHHHHCCCCCCCCCCHHHHCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHCCCC
SKPDKPWFMWYNPGANHAPHHAPADYIAKYKGKFDDGYEAYRDWVLKRMIDKGILPKGTK
CCCCCCEEEEECCCCCCCCCCCCHHHHHHHCCCCCCHHHHHHHHHHHHHHHCCCCCCCCC
MTPLNPMPKGKFAESDMVKPWNSLTADEKKLFSRMAEVYAAYSEFTDAEVGRVIKYLKDS
CCCCCCCCCCCCCCCCCCCCCHHCCHHHHHHHHHHHHHHHHHHHHCHHHHHHHHHHHHCC
GQFDNTLIMYCADNGASAEGSPNGSVNENNFFNAYPDDMSVNLSMIDKLGSEDTYNHYPT
CCCCCEEEEEEECCCCCCCCCCCCCCCCCCCCCCCCCCCEEEHHHHHHCCCCCCCCCCCC
GWAAAFSTPFKMFKRYSGYSGGTADPLVICWPKGIKAKGELRSQYYHCTDIVPTILEACG
CHHHHHHHHHHHHHHHCCCCCCCCCCEEEECCCCCCCCHHHHHHHHHHHHHHHHHHHHHC
LTMPDVVDGVKQTPLAGVSMISSFNNAKAPTAKKVQYYEMVGTRGIWKDGWKATAVHGAL
CCCHHHHHHHHHCCHHHHHHHHHCCCCCCCCHHHEEHHHHHCCCCCCCCCCEEEEECCEE
PVNIGNFDKDQWELYNVDADRSESTDLAVKYPDKVKELQQIWMDEAKKYHVLPLNDLSIP
EEECCCCCCCCEEEEECCCCCCCCCCEEEECCHHHHHHHHHHHHHCCCEEEEECCCCCCC
EFHKLEYHKEVPADGRFIYYPGTTEVPEASAAPTLGRSFKILAEVDFTKDSKGVIVSQGS
CHHHHHHHCCCCCCCEEEEECCCCCCCCCCCCCCCCCCEEEEEEEECCCCCCCEEEECCC
RFGGYSLFAKDGKLTYVYNFLGLAPEQVLSTSIPSSGKHIVGVEFIKEKMSDKNETLGKM
CCCCEEEEECCCCEEEEEHHHCCCHHHHHHCCCCCCCCEEEEHHHHHHHHCCCHHHHHHE
RLYLDNKVVDEKPFRTQAGHYSLSGEGLCVGRDSGDPVSKQYKAKFDFTGGKIAKVVYDV
EEEECCCCCCCCCCCCCCCCEEECCCEEEEECCCCCCCCHHHEEEEECCCCEEEEEEEEC
SNDAYQNVENEFKVKMAKE
CCHHHHCCCCCEEEEECCC
>Mature Secondary Structure
MKQLFKLLIFLFCSFLMAQNPPKKQEEKKFGGDIKLDIRDSKGDWPAFLETKAPKDAPNV
CHHHHHHHHHHHHHHHHHCCCCCHHHHHHCCCEEEEEEECCCCCCCEEEECCCCCCCCCE
LIILYDDTGFAAWSPYGGRINMPTMDELAKNGLTYTQWHTTSVCSPTRSTLLTGRNHHQN
EEEEECCCCCEEECCCCCEECCCCHHHHHHCCCEEEEECCCCCCCCCHHHHCCCCCCCCC
GFGSISESAVGFPGYSGHIPKENATLATVLREAGWSTFWIGKNHNVPVDALDMASSKERW
CCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHCCCCEEEECCCCCCCCHHHHCCCCCCCC
PLGLGFDRFYGFIGGETNQWYPSLIEDNHFIEQPSQPENGYHLSKDLADKAIAYIQDSKQ
CCCCCHHHHHHCCCCCCCCCCHHHHCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHCCCC
SKPDKPWFMWYNPGANHAPHHAPADYIAKYKGKFDDGYEAYRDWVLKRMIDKGILPKGTK
CCCCCCEEEEECCCCCCCCCCCCHHHHHHHCCCCCCHHHHHHHHHHHHHHHCCCCCCCCC
MTPLNPMPKGKFAESDMVKPWNSLTADEKKLFSRMAEVYAAYSEFTDAEVGRVIKYLKDS
CCCCCCCCCCCCCCCCCCCCCHHCCHHHHHHHHHHHHHHHHHHHHCHHHHHHHHHHHHCC
GQFDNTLIMYCADNGASAEGSPNGSVNENNFFNAYPDDMSVNLSMIDKLGSEDTYNHYPT
CCCCCEEEEEEECCCCCCCCCCCCCCCCCCCCCCCCCCCEEEHHHHHHCCCCCCCCCCCC
GWAAAFSTPFKMFKRYSGYSGGTADPLVICWPKGIKAKGELRSQYYHCTDIVPTILEACG
CHHHHHHHHHHHHHHHCCCCCCCCCCEEEECCCCCCCCHHHHHHHHHHHHHHHHHHHHHC
LTMPDVVDGVKQTPLAGVSMISSFNNAKAPTAKKVQYYEMVGTRGIWKDGWKATAVHGAL
CCCHHHHHHHHHCCHHHHHHHHHCCCCCCCCHHHEEHHHHHCCCCCCCCCCEEEEECCEE
PVNIGNFDKDQWELYNVDADRSESTDLAVKYPDKVKELQQIWMDEAKKYHVLPLNDLSIP
EEECCCCCCCCEEEEECCCCCCCCCCEEEECCHHHHHHHHHHHHHCCCEEEEECCCCCCC
EFHKLEYHKEVPADGRFIYYPGTTEVPEASAAPTLGRSFKILAEVDFTKDSKGVIVSQGS
CHHHHHHHCCCCCCCEEEEECCCCCCCCCCCCCCCCCCEEEEEEEECCCCCCCEEEECCC
RFGGYSLFAKDGKLTYVYNFLGLAPEQVLSTSIPSSGKHIVGVEFIKEKMSDKNETLGKM
CCCCEEEEECCCCEEEEEHHHCCCHHHHHHCCCCCCCCEEEEHHHHHHHHCCCHHHHHHE
RLYLDNKVVDEKPFRTQAGHYSLSGEGLCVGRDSGDPVSKQYKAKFDFTGGKIAKVVYDV
EEEECCCCCCCCCCCCCCCCEEECCCEEEEECCCCCCCCHHHEEEEECCCCEEEEEEEEC
SNDAYQNVENEFKVKMAKE
CCHHHHCCCCCEEEEECCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 7744061; 10984043 [H]