Definition Sphingopyxis alaskensis RB2256, complete genome.
Accession NC_008048
Length 3,345,170

Click here to switch to the map view.

The map label for this gene is argH

Identifier: 103485697

GI number: 103485697

Start: 215765

End: 217171

Strand: Direct

Name: argH

Synonym: Sala_0201

Alternate gene names: 103485697

Gene position: 215765-217171 (Clockwise)

Preceding gene: 103485695

Following gene: 103485698

Centisome position: 6.45

GC content: 69.79

Gene sequence:

>1407_bases
ATGGCGAATACTCCGGACAAGAGCAGCATGTGGGGCGGCCGCTTCGGTGGCGGACCGGCGGCGATCATGCAAGAGATTAA
CGCCTCGATCCCCATCGACAAGCGCCTTTGGGAAGAGGACATCGCCGCCAGCCGCGCCCACGCCGCGATGCTCGGTGCTT
GCCGAATCATCAGTGCCGACGATGCGGCAGCGATCGACCGCGGTCTTGCCCAGATCGCCGAAGAATTTGCCGAAAACGGC
GTGCCCGTCGACCTCAGCCTCGAGGACATCCACATGACCGTCGAGGCGCGGCTGAAGGAGTTGATCGGCGAACCCGCCGG
GCGCCTCCACACCGCGCGCTCGCGCAACGACCAGGTCGCGACCGATTTCCGCCTGTGGACGCGTACCGCCTGCGAGCGCA
TCGACGCCGGGCTCGCCGCGCTCCAGTCGGCGCTGCTTCAGCGCGCCGACGAGCATGCCGACAGCATCATGCCGGGCTTC
ACGCATTTGCAGGTCGCGCAGCCGGTGACGCTCGGCCACCATCTGCTCGCCTATGTCGAAATGGCGCGCCGCGACCGCGG
CCGCTTCGCCGATGCGCGCCGCCGCCTCAACGAATCGCCGCTCGGCGCCGCGGCGCTCGCGGGGACGGGCTTTCCTGTCG
ATCGCGACGCCACCGCTGCGGCGCTCGGCTTCGACCGGCCGATGGCGAACAGCATCGACGCGGTATCCGACCGCGACTTC
GCGCTCGAGTTCTGCGCCGCCGCGGCGATCGCCGCGATCCACCTGTCGCGCCTTGCCGAAGAAATCGTCATCTGGGCCAG
CCAGCCCTTCGGCTTCGTCGCGCTGCCCGATGCCTGGTCGACGGGCAGTTCGATCATGCCGCAAAAGCGCAACCCCGACG
CCGCCGAACTGGTGCGTGGGCGCGCGGGCCTGCTGCTCGGCGCCTTCCAGCGGCTCGCCGTCATCGTCAAAGGGCTGCCG
CTCACCTATTCGAAAGACCTTCAGGACGACAAGGAAACGCTCTTCGGCGCGTTCGACGCGCTCGCGCTGTCGCTCGCGGC
GATGACGGGCATGGTCGAAACGCTGAGCTTCCGCACCGACCGGATGCGCGCGCTCGCCGCGTCGGGCTATTCGACCGCGA
CCGACCTTGCCGACTGGCTGGTGCGCGAGGCGGGGCTGCCGTTCCGCGAAGCGCATCATGTCGTCGGCGCCTGCGTCAGG
CGCGCCGAGGAACTGGGCGTCGAGCTGCCCGCGCTGCCCGCCGCCGACGCGGCGGCGATCCACGCCGCGGTCACCCCCGA
TGTCCTCGCCGCACTCACGGTCGAAGCATCGGTCGCCAGCCGCATGAGCTATGGCGGGACCGCGCCCGAACGGGTAAGAC
AGGCCATCGCTGCGGCGCGCGCTGCCGCGGCCCAGGGACAGGATTGA

Upstream 100 bases:

>100_bases
CTGCGCTTGCCCGCCGCCCGCCTTTTCCCTATCGCAGCCCGCGACCGATCCGGCCAGCAACAGGCCCAGGATCAACAGCG
ACGGATTTGGAACGCGGCGG

Downstream 100 bases:

>100_bases
TGTCGCACCGCCACCATATCCTTGCCACGCTCGCCGTTGCCGCGCTGCTCGGCGCGTGCGGGGCCAAGGAAGATCTGAAG
CCGCCGGCGAACCAGCCGGC

Product: argininosuccinate lyase

Products: NA

Alternate protein names: ASAL; Arginosuccinase

Number of amino acids: Translated: 468; Mature: 467

Protein sequence:

>468_residues
MANTPDKSSMWGGRFGGGPAAIMQEINASIPIDKRLWEEDIAASRAHAAMLGACRIISADDAAAIDRGLAQIAEEFAENG
VPVDLSLEDIHMTVEARLKELIGEPAGRLHTARSRNDQVATDFRLWTRTACERIDAGLAALQSALLQRADEHADSIMPGF
THLQVAQPVTLGHHLLAYVEMARRDRGRFADARRRLNESPLGAAALAGTGFPVDRDATAAALGFDRPMANSIDAVSDRDF
ALEFCAAAAIAAIHLSRLAEEIVIWASQPFGFVALPDAWSTGSSIMPQKRNPDAAELVRGRAGLLLGAFQRLAVIVKGLP
LTYSKDLQDDKETLFGAFDALALSLAAMTGMVETLSFRTDRMRALAASGYSTATDLADWLVREAGLPFREAHHVVGACVR
RAEELGVELPALPAADAAAIHAAVTPDVLAALTVEASVASRMSYGGTAPERVRQAIAAARAAAAQGQD

Sequences:

>Translated_468_residues
MANTPDKSSMWGGRFGGGPAAIMQEINASIPIDKRLWEEDIAASRAHAAMLGACRIISADDAAAIDRGLAQIAEEFAENG
VPVDLSLEDIHMTVEARLKELIGEPAGRLHTARSRNDQVATDFRLWTRTACERIDAGLAALQSALLQRADEHADSIMPGF
THLQVAQPVTLGHHLLAYVEMARRDRGRFADARRRLNESPLGAAALAGTGFPVDRDATAAALGFDRPMANSIDAVSDRDF
ALEFCAAAAIAAIHLSRLAEEIVIWASQPFGFVALPDAWSTGSSIMPQKRNPDAAELVRGRAGLLLGAFQRLAVIVKGLP
LTYSKDLQDDKETLFGAFDALALSLAAMTGMVETLSFRTDRMRALAASGYSTATDLADWLVREAGLPFREAHHVVGACVR
RAEELGVELPALPAADAAAIHAAVTPDVLAALTVEASVASRMSYGGTAPERVRQAIAAARAAAAQGQD
>Mature_467_residues
ANTPDKSSMWGGRFGGGPAAIMQEINASIPIDKRLWEEDIAASRAHAAMLGACRIISADDAAAIDRGLAQIAEEFAENGV
PVDLSLEDIHMTVEARLKELIGEPAGRLHTARSRNDQVATDFRLWTRTACERIDAGLAALQSALLQRADEHADSIMPGFT
HLQVAQPVTLGHHLLAYVEMARRDRGRFADARRRLNESPLGAAALAGTGFPVDRDATAAALGFDRPMANSIDAVSDRDFA
LEFCAAAAIAAIHLSRLAEEIVIWASQPFGFVALPDAWSTGSSIMPQKRNPDAAELVRGRAGLLLGAFQRLAVIVKGLPL
TYSKDLQDDKETLFGAFDALALSLAAMTGMVETLSFRTDRMRALAASGYSTATDLADWLVREAGLPFREAHHVVGACVRR
AEELGVELPALPAADAAAIHAAVTPDVLAALTVEASVASRMSYGGTAPERVRQAIAAARAAAAQGQD

Specific function: Arginine biosynthesis; eighth (last) step. [C]

COG id: COG0165

COG function: function code E; Argininosuccinate lyase

Gene ontology:

Cell location: Cytoplasm

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the lyase 1 family. Argininosuccinate lyase subfamily

Homologues:

Organism=Homo sapiens, GI31541964, Length=456, Percent_Identity=42.1052631578947, Blast_Score=356, Evalue=3e-98,
Organism=Homo sapiens, GI68303542, Length=456, Percent_Identity=42.1052631578947, Blast_Score=356, Evalue=3e-98,
Organism=Homo sapiens, GI68303549, Length=456, Percent_Identity=40.1315789473684, Blast_Score=325, Evalue=7e-89,
Organism=Homo sapiens, GI68303547, Length=456, Percent_Identity=39.6929824561403, Blast_Score=324, Evalue=1e-88,
Organism=Escherichia coli, GI1790398, Length=454, Percent_Identity=42.511013215859, Blast_Score=363, Evalue=1e-101,
Organism=Caenorhabditis elegans, GI17553882, Length=251, Percent_Identity=28.2868525896414, Blast_Score=69, Evalue=5e-12,
Organism=Saccharomyces cerevisiae, GI6321806, Length=456, Percent_Identity=39.9122807017544, Blast_Score=341, Evalue=1e-94,
Organism=Drosophila melanogaster, GI221473854, Length=470, Percent_Identity=39.1489361702128, Blast_Score=337, Evalue=1e-92,
Organism=Drosophila melanogaster, GI78706858, Length=470, Percent_Identity=39.1489361702128, Blast_Score=337, Evalue=1e-92,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): ARLY_SPHAL (Q1GWP7)

Other databases:

- EMBL:   CP000356
- RefSeq:   YP_615258.1
- ProteinModelPortal:   Q1GWP7
- SMR:   Q1GWP7
- GeneID:   4082117
- GenomeReviews:   CP000356_GR
- KEGG:   sal:Sala_0201
- NMPDR:   fig|317655.9.peg.181
- HOGENOM:   HBG539632
- OMA:   KSMVDRA
- BioCyc:   SALA317655:SALA_0201-MONOMER
- BRENDA:   4.3.2.1
- GO:   GO:0005737
- HAMAP:   MF_00006
- InterPro:   IPR009049
- InterPro:   IPR003031
- InterPro:   IPR000362
- InterPro:   IPR020557
- InterPro:   IPR008948
- InterPro:   IPR022761
- PANTHER:   PTHR11444:SF3
- PRINTS:   PR00145
- PRINTS:   PR00149
- TIGRFAMs:   TIGR00838

Pfam domain/function: PF00206 Lyase_1; SSF48557 L-Aspartase-like

EC number: =4.3.2.1

Molecular weight: Translated: 49728; Mature: 49597

Theoretical pI: Translated: 5.21; Mature: 5.21

Prosite motif: PS00163 FUMARATE_LYASES

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.9 %Cys     (Translated Protein)
2.8 %Met     (Translated Protein)
3.6 %Cys+Met (Translated Protein)
0.9 %Cys     (Mature Protein)
2.6 %Met     (Mature Protein)
3.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MANTPDKSSMWGGRFGGGPAAIMQEINASIPIDKRLWEEDIAASRAHAAMLGACRIISAD
CCCCCCCCCCCCCCCCCCHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHEECCC
DAAAIDRGLAQIAEEFAENGVPVDLSLEDIHMTVEARLKELIGEPAGRLHTARSRNDQVA
CHHHHHHHHHHHHHHHHHCCCCEEEEHHHHHHHHHHHHHHHHCCCHHHHHHHCCCCCCHH
TDFRLWTRTACERIDAGLAALQSALLQRADEHADSIMPGFTHLQVAQPVTLGHHLLAYVE
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHCCCHHHHHHHHHHHH
MARRDRGRFADARRRLNESPLGAAALAGTGFPVDRDATAAALGFDRPMANSIDAVSDRDF
HHHHHCCCHHHHHHHCCCCCCCHHHHCCCCCCCCCCCHHHHHCCCCCCCCCCCCCCCCHH
ALEFCAAAAIAAIHLSRLAEEIVIWASQPFGFVALPDAWSTGSSIMPQKRNPDAAELVRG
HHHHHHHHHHHHHHHHHHHHHHEEECCCCCCEEECCCCCCCCCCCCCCCCCCCHHHHHHH
RAGLLLGAFQRLAVIVKGLPLTYSKDLQDDKETLFGAFDALALSLAAMTGMVETLSFRTD
HHHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
RMRALAASGYSTATDLADWLVREAGLPFREAHHVVGACVRRAEELGVELPALPAADAAAI
HHHHHHHCCCCHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHCCCCCCCCCCCCHHHH
HAAVTPDVLAALTVEASVASRMSYGGTAPERVRQAIAAARAAAAQGQD
HHHCCHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHCCCCC
>Mature Secondary Structure 
ANTPDKSSMWGGRFGGGPAAIMQEINASIPIDKRLWEEDIAASRAHAAMLGACRIISAD
CCCCCCCCCCCCCCCCCHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHEECCC
DAAAIDRGLAQIAEEFAENGVPVDLSLEDIHMTVEARLKELIGEPAGRLHTARSRNDQVA
CHHHHHHHHHHHHHHHHHCCCCEEEEHHHHHHHHHHHHHHHHCCCHHHHHHHCCCCCCHH
TDFRLWTRTACERIDAGLAALQSALLQRADEHADSIMPGFTHLQVAQPVTLGHHLLAYVE
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHCCCHHHHHHHHHHHH
MARRDRGRFADARRRLNESPLGAAALAGTGFPVDRDATAAALGFDRPMANSIDAVSDRDF
HHHHHCCCHHHHHHHCCCCCCCHHHHCCCCCCCCCCCHHHHHCCCCCCCCCCCCCCCCHH
ALEFCAAAAIAAIHLSRLAEEIVIWASQPFGFVALPDAWSTGSSIMPQKRNPDAAELVRG
HHHHHHHHHHHHHHHHHHHHHHEEECCCCCCEEECCCCCCCCCCCCCCCCCCCHHHHHHH
RAGLLLGAFQRLAVIVKGLPLTYSKDLQDDKETLFGAFDALALSLAAMTGMVETLSFRTD
HHHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
RMRALAASGYSTATDLADWLVREAGLPFREAHHVVGACVRRAEELGVELPALPAADAAAI
HHHHHHHCCCCHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHCCCCCCCCCCCCHHHH
HAAVTPDVLAALTVEASVASRMSYGGTAPERVRQAIAAARAAAAQGQD
HHHCCHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA