Definition Hyphomonas neptunium ATCC 15444 chromosome, complete genome.
Accession NC_008358
Length 3,705,021

Click here to switch to the map view.

The map label for this gene is aslA [H]

Identifier: 114799529

GI number: 114799529

Start: 2565115

End: 2566494

Strand: Direct

Name: aslA [H]

Synonym: HNE_2449

Alternate gene names: 114799529

Gene position: 2565115-2566494 (Clockwise)

Preceding gene: 114797445

Following gene: 114798011

Centisome position: 69.23

GC content: 57.25

Gene sequence:

>1380_bases
ATGCCCCTCAAGATCGCCCGCTGGACAGCGGCCATCATGCTGACTGCCGCATGCGCCGCTTCACCCGCAGCCAACATCGC
GACTTCGGAGACAGCGCCGGCAGCTGCAAAGCCGCCCAACATTATCATCATCATGGCCGATGATCTTGGCTGGGGTGACA
TCAGCCTGAACGGCGCTGCATTGATCGAAACGCCCAACATCGACCGGATTGGGCAGGAAGGCATCCAGCTGACGGATTTC
TACGCCGGATCGAATGTCTGCTCCCCTTCCCGCGCGGCGCTGCTGACCGGGCGCTACCCCATCAGGTCCGGCATGCAGCA
TGTGATTTTCCCGCACTCTCAAGATGGTCTTCCTGCAGAAGAAATCACCATTTCGGAAATGCTCAAGAATGCCGGCTATC
GGACAGGCATGGTAGGCAAATGGCACCTTGGGCATCAGGAGGAATACTGGCCAACCAATCAGGGCTTCGACTGGTTTTAC
GGTGTTCCCTATTCAAACGATATGGCCCCGTTTGATCTTTATCGTGGCAAGGAAATCATTGAGAGCCCCGCCGACCAGAG
TCAGCTGAGCCTGAATTACGCCAAAGCCGCAAAAGAATTCATTGAGGACTCTTCAGACAAGCCGTTCTTCCTCTATTATG
CAGAGACATTCCCGCACATACCTTTGTTCGTACCGGAAGATCGCAGCGGAACTTCCGATGCAGGACTTTATGGCGATGTT
GTTGAGACCGTGGATGCCGGTATCGGAATTGTTCTGGACACTCTGGACGAAGCCGGCGTGGCGGACGACACGCTGATTAT
TTTCACCAGCGATAACGGCCCCTGGTTTGAAGGCAGCGCCGGCGAGTTTCGCGGACGCAAAGGCGAAACGCATGAAGGTG
GATTTCGGGTTCCGTTTCTGGCGCGCTGGCCGGGCCACATCCCTAAAGGCTCCGTCAGCCATGAGATGGCAATGAACATT
GACCTTCTTCCCACCGCAGCATCGCTGTCCGGCGCCACCCTCCCCGCCGACCGCGTGATTGACGGCAAGGACCTGACCAG
CCTTCTGACAGCTGGCGCTCCGACACCGCATGATATTCTGTTTTTCTTCGACGGAAACGAGATTGTCGGCGCCCGCGATG
CGCGCTTCAGACTGGTGCTCAACACATTCTACCGTACCATGAGTGTTCCTTTCGAGTATTTCGGCACCGCGCTTCTGTTC
GACCTTGAGAAAGATCCGCAGGAATCCTTCAGCTTCATGCGAGAGTATCCCGGCGAGGCAGAGCGGCTCAAATCAGCTGT
CGCAGCCATGCGCGCGGCAGTTGCGGAGAAAACCAAGGAGGCCACCAGCCACGTGCCGCCCAATGACGGAACTCCGACCG
GCCCGCAGTTGACACGTTAG

Upstream 100 bases:

>100_bases
ACGAAACAGGACGCCAAACGCGCGCCTCATAAACTAAACGGCTGGGCGGCCGTTACTGGCTGCCCAGCGCCTTCTTCCGG
TATCTGGAAAGGAACCCGTG

Downstream 100 bases:

>100_bases
ACCCGGAAAAGACCATTGCGGAGCTTCAGGTGATTGTGGCAGGAGCCAGATCACCTTGATAGCGCCGCGCCGGCAGGACG
GTGGCTTCCCTCATGGGCAG

Product: sulfatase family protein

Products: NA

Alternate protein names: AS; Aryl-sulfate sulphohydrolase [H]

Number of amino acids: Translated: 459; Mature: 458

Protein sequence:

>459_residues
MPLKIARWTAAIMLTAACAASPAANIATSETAPAAAKPPNIIIIMADDLGWGDISLNGAALIETPNIDRIGQEGIQLTDF
YAGSNVCSPSRAALLTGRYPIRSGMQHVIFPHSQDGLPAEEITISEMLKNAGYRTGMVGKWHLGHQEEYWPTNQGFDWFY
GVPYSNDMAPFDLYRGKEIIESPADQSQLSLNYAKAAKEFIEDSSDKPFFLYYAETFPHIPLFVPEDRSGTSDAGLYGDV
VETVDAGIGIVLDTLDEAGVADDTLIIFTSDNGPWFEGSAGEFRGRKGETHEGGFRVPFLARWPGHIPKGSVSHEMAMNI
DLLPTAASLSGATLPADRVIDGKDLTSLLTAGAPTPHDILFFFDGNEIVGARDARFRLVLNTFYRTMSVPFEYFGTALLF
DLEKDPQESFSFMREYPGEAERLKSAVAAMRAAVAEKTKEATSHVPPNDGTPTGPQLTR

Sequences:

>Translated_459_residues
MPLKIARWTAAIMLTAACAASPAANIATSETAPAAAKPPNIIIIMADDLGWGDISLNGAALIETPNIDRIGQEGIQLTDF
YAGSNVCSPSRAALLTGRYPIRSGMQHVIFPHSQDGLPAEEITISEMLKNAGYRTGMVGKWHLGHQEEYWPTNQGFDWFY
GVPYSNDMAPFDLYRGKEIIESPADQSQLSLNYAKAAKEFIEDSSDKPFFLYYAETFPHIPLFVPEDRSGTSDAGLYGDV
VETVDAGIGIVLDTLDEAGVADDTLIIFTSDNGPWFEGSAGEFRGRKGETHEGGFRVPFLARWPGHIPKGSVSHEMAMNI
DLLPTAASLSGATLPADRVIDGKDLTSLLTAGAPTPHDILFFFDGNEIVGARDARFRLVLNTFYRTMSVPFEYFGTALLF
DLEKDPQESFSFMREYPGEAERLKSAVAAMRAAVAEKTKEATSHVPPNDGTPTGPQLTR
>Mature_458_residues
PLKIARWTAAIMLTAACAASPAANIATSETAPAAAKPPNIIIIMADDLGWGDISLNGAALIETPNIDRIGQEGIQLTDFY
AGSNVCSPSRAALLTGRYPIRSGMQHVIFPHSQDGLPAEEITISEMLKNAGYRTGMVGKWHLGHQEEYWPTNQGFDWFYG
VPYSNDMAPFDLYRGKEIIESPADQSQLSLNYAKAAKEFIEDSSDKPFFLYYAETFPHIPLFVPEDRSGTSDAGLYGDVV
ETVDAGIGIVLDTLDEAGVADDTLIIFTSDNGPWFEGSAGEFRGRKGETHEGGFRVPFLARWPGHIPKGSVSHEMAMNID
LLPTAASLSGATLPADRVIDGKDLTSLLTAGAPTPHDILFFFDGNEIVGARDARFRLVLNTFYRTMSVPFEYFGTALLFD
LEKDPQESFSFMREYPGEAERLKSAVAAMRAAVAEKTKEATSHVPPNDGTPTGPQLTR

Specific function: Unknown

COG id: COG3119

COG function: function code P; Arylsulfatase A and related enzymes

Gene ontology:

Cell location: Periplasm (Potential) [H]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the sulfatase family [H]

Homologues:

Organism=Homo sapiens, GI146229331, Length=426, Percent_Identity=38.2629107981221, Blast_Score=270, Evalue=2e-72,
Organism=Homo sapiens, GI146229329, Length=426, Percent_Identity=38.2629107981221, Blast_Score=270, Evalue=2e-72,
Organism=Homo sapiens, GI6005990, Length=426, Percent_Identity=38.2629107981221, Blast_Score=270, Evalue=2e-72,
Organism=Homo sapiens, GI146229324, Length=426, Percent_Identity=38.2629107981221, Blast_Score=270, Evalue=2e-72,
Organism=Homo sapiens, GI4503899, Length=459, Percent_Identity=36.6013071895425, Blast_Score=257, Evalue=2e-68,
Organism=Homo sapiens, GI45430057, Length=375, Percent_Identity=37.3333333333333, Blast_Score=251, Evalue=9e-67,
Organism=Homo sapiens, GI146229327, Length=354, Percent_Identity=35.5932203389831, Blast_Score=193, Evalue=3e-49,
Organism=Homo sapiens, GI38569405, Length=466, Percent_Identity=29.3991416309013, Blast_Score=182, Evalue=4e-46,
Organism=Homo sapiens, GI38569407, Length=364, Percent_Identity=32.967032967033, Blast_Score=180, Evalue=3e-45,
Organism=Homo sapiens, GI59797060, Length=348, Percent_Identity=34.1954022988506, Blast_Score=175, Evalue=8e-44,
Organism=Homo sapiens, GI109389362, Length=359, Percent_Identity=32.5905292479109, Blast_Score=169, Evalue=7e-42,
Organism=Homo sapiens, GI31742482, Length=299, Percent_Identity=32.7759197324415, Blast_Score=149, Evalue=7e-36,
Organism=Homo sapiens, GI53831991, Length=307, Percent_Identity=33.2247557003257, Blast_Score=144, Evalue=1e-34,
Organism=Homo sapiens, GI157266309, Length=172, Percent_Identity=42.4418604651163, Blast_Score=140, Evalue=2e-33,
Organism=Homo sapiens, GI58743319, Length=139, Percent_Identity=48.2014388489209, Blast_Score=139, Evalue=4e-33,
Organism=Homo sapiens, GI71852586, Length=157, Percent_Identity=43.312101910828, Blast_Score=130, Evalue=2e-30,
Organism=Homo sapiens, GI71852584, Length=157, Percent_Identity=43.312101910828, Blast_Score=129, Evalue=5e-30,
Organism=Homo sapiens, GI4506919, Length=417, Percent_Identity=26.1390887290168, Blast_Score=107, Evalue=3e-23,
Organism=Escherichia coli, GI1790233, Length=454, Percent_Identity=31.057268722467, Blast_Score=166, Evalue=4e-42,
Organism=Escherichia coli, GI87081924, Length=396, Percent_Identity=29.040404040404, Blast_Score=148, Evalue=6e-37,
Organism=Escherichia coli, GI1790112, Length=437, Percent_Identity=24.0274599542334, Blast_Score=89, Evalue=7e-19,
Organism=Caenorhabditis elegans, GI115533416, Length=450, Percent_Identity=28.6666666666667, Blast_Score=156, Evalue=2e-38,
Organism=Caenorhabditis elegans, GI17559078, Length=261, Percent_Identity=33.7164750957854, Blast_Score=145, Evalue=6e-35,
Organism=Caenorhabditis elegans, GI115533418, Length=439, Percent_Identity=28.4738041002278, Blast_Score=144, Evalue=7e-35,
Organism=Drosophila melanogaster, GI24666109, Length=369, Percent_Identity=33.3333333333333, Blast_Score=167, Evalue=1e-41,
Organism=Drosophila melanogaster, GI281366397, Length=363, Percent_Identity=33.8842975206612, Blast_Score=166, Evalue=2e-41,
Organism=Drosophila melanogaster, GI281366395, Length=363, Percent_Identity=33.8842975206612, Blast_Score=166, Evalue=2e-41,
Organism=Drosophila melanogaster, GI24666163, Length=363, Percent_Identity=33.8842975206612, Blast_Score=166, Evalue=2e-41,
Organism=Drosophila melanogaster, GI24666175, Length=367, Percent_Identity=32.9700272479564, Blast_Score=164, Evalue=8e-41,
Organism=Drosophila melanogaster, GI281363223, Length=411, Percent_Identity=30.6569343065693, Blast_Score=158, Evalue=6e-39,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR017849
- InterPro:   IPR017850
- InterPro:   IPR000917 [H]

Pfam domain/function: PF00884 Sulfatase [H]

EC number: =3.1.6.1 [H]

Molecular weight: Translated: 49941; Mature: 49809

Theoretical pI: Translated: 4.49; Mature: 4.49

Prosite motif: PS00013 PROKAR_LIPOPROTEIN ; PS00149 SULFATASE_2

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.4 %Cys     (Translated Protein)
2.6 %Met     (Translated Protein)
3.1 %Cys+Met (Translated Protein)
0.4 %Cys     (Mature Protein)
2.4 %Met     (Mature Protein)
2.8 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MPLKIARWTAAIMLTAACAASPAANIATSETAPAAAKPPNIIIIMADDLGWGDISLNGAA
CCCCHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCEEEEEECCCCCCEEEECCEE
LIETPNIDRIGQEGIQLTDFYAGSNVCSPSRAALLTGRYPIRSGMQHVIFPHSQDGLPAE
EEECCCCHHHCCCCCEEEEEECCCCCCCCCCCEEEECCCCHHHCCCEEECCCCCCCCCHH
EITISEMLKNAGYRTGMVGKWHLGHQEEYWPTNQGFDWFYGVPYSNDMAPFDLYRGKEII
HHHHHHHHHHCCCCCCCEEEEECCCCCCCCCCCCCCCEEEECCCCCCCCCHHHHCCHHHH
ESPADQSQLSLNYAKAAKEFIEDSSDKPFFLYYAETFPHIPLFVPEDRSGTSDAGLYGDV
HCCCCHHHHHHHHHHHHHHHHHCCCCCCEEEEEECCCCCCCEEECCCCCCCCCCCCHHHH
VETVDAGIGIVLDTLDEAGVADDTLIIFTSDNGPWFEGSAGEFRGRKGETHEGGFRVPFL
HHHHHCCCEEEEECCCCCCCCCCEEEEEECCCCCEECCCCCCCCCCCCCCCCCCEECCEE
ARWPGHIPKGSVSHEMAMNIDLLPTAASLSGATLPADRVIDGKDLTSLLTAGAPTPHDIL
ECCCCCCCCCCCCCCEEEEEEEECCCCCCCCCCCCCCCEECCHHHHHHHHCCCCCCCEEE
FFFDGNEIVGARDARFRLVLNTFYRTMSVPFEYFGTALLFDLEKDPQESFSFMREYPGEA
EEECCCEEECCCCCEEHHHHHHHHHHHCCCHHHCCEEEEEECCCCHHHHHHHHHHCCCHH
ERLKSAVAAMRAAVAEKTKEATSHVPPNDGTPTGPQLTR
HHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCC
>Mature Secondary Structure 
PLKIARWTAAIMLTAACAASPAANIATSETAPAAAKPPNIIIIMADDLGWGDISLNGAA
CCCHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCEEEEEECCCCCCEEEECCEE
LIETPNIDRIGQEGIQLTDFYAGSNVCSPSRAALLTGRYPIRSGMQHVIFPHSQDGLPAE
EEECCCCHHHCCCCCEEEEEECCCCCCCCCCCEEEECCCCHHHCCCEEECCCCCCCCCHH
EITISEMLKNAGYRTGMVGKWHLGHQEEYWPTNQGFDWFYGVPYSNDMAPFDLYRGKEII
HHHHHHHHHHCCCCCCCEEEEECCCCCCCCCCCCCCCEEEECCCCCCCCCHHHHCCHHHH
ESPADQSQLSLNYAKAAKEFIEDSSDKPFFLYYAETFPHIPLFVPEDRSGTSDAGLYGDV
HCCCCHHHHHHHHHHHHHHHHHCCCCCCEEEEEECCCCCCCEEECCCCCCCCCCCCHHHH
VETVDAGIGIVLDTLDEAGVADDTLIIFTSDNGPWFEGSAGEFRGRKGETHEGGFRVPFL
HHHHHCCCEEEEECCCCCCCCCCEEEEEECCCCCEECCCCCCCCCCCCCCCCCCEECCEE
ARWPGHIPKGSVSHEMAMNIDLLPTAASLSGATLPADRVIDGKDLTSLLTAGAPTPHDIL
ECCCCCCCCCCCCCCEEEEEEEECCCCCCCCCCCCCCCEECCHHHHHHHHCCCCCCCEEE
FFFDGNEIVGARDARFRLVLNTFYRTMSVPFEYFGTALLFDLEKDPQESFSFMREYPGEA
EEECCCEEECCCCCEEHHHHHHHHHHHCCCHHHCCEEEEEECCCCHHHHHHHHHHCCCHH
ERLKSAVAAMRAAVAEKTKEATSHVPPNDGTPTGPQLTR
HHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 1379743; 9278503 [H]