| Definition | Cupriavidus metallidurans CH34 megaplasmid, complete sequence. |
|---|---|
| Accession | NC_007974 |
| Length | 2,580,084 |
Click here to switch to the map view.
The map label for this gene is argH1 [H]
Identifier: 94313267
GI number: 94313267
Start: 937734
End: 939236
Strand: Reverse
Name: argH1 [H]
Synonym: Rmet_4342
Alternate gene names: 94313267
Gene position: 939236-937734 (Counterclockwise)
Preceding gene: 94313268
Following gene: 94313266
Centisome position: 36.4
GC content: 61.94
Gene sequence:
>1503_bases ATGACATCGACTCCCCACGAAACACTACTTGCCGAGGCTCGCCTGAGTTCGCCTCCTGCCTCCCGGTTGACGAAGCACTA CGCACTGCCAGGGCTCGAGCGCGAACGCAGGCAGTTTCACGAGTTCGTCGCCGTTGATCTTGCCCATACGACCATGCTCG TGGAACAGGGCATTCTTTCGGCGGAGACCGGTCGGGCCATCCTGGAGCAATTGCTGATCATTCGGAGAATGCAGCCCTCC GCGTTTCCCGTGGATGTGCGCAAGGGCAGCCTTCTGCTGCAGATCGAGTCGTATCTCTTCGGCGCCATCGGCGAGGACGT GGGCGGCCAGATGCACACCGGCCGCAGCCGCATCGATCAGGGCGCCACGGTACGCCGCCTGTACAAGCGCAACCGCATGC TGGATGTGATGGACCAGTTGAACGTATTCCAGGAGGCGATTGCCGAACAAGCGCGCCACCACGCGCACACGATCATGCCC GGCTACACCCATATGCAGCAGGCCCAGCCATGGGTGTTCGGACACTATCTGCTCAGCTTCAGCTCCCGATTGCATGACAG CTTCGAGCGTCTGGCGCAGGCGTACGGACGCGTCAACCGCAATCCACTGGGAACCGTGGGTCTTGCCGGCACGTCATGGC CGCTTAATCGCGAGCGAACCACGGAACTGCTCGGATTCGACGGCCAAATCGAGAACTCCAAGCTTGGCCGCGAAGCTTTC GATGCAGCGGATGCGATCTGCGCACTGTCGTTCATCATGGCCGATTTGAACGATCTGGCTACCGACCTGCATATCTGGTC CAGTGCCGAGTTCGGATTGGTTGAATCCGATGACAGCTACTGTGGTACGAGCAGCATCTTCCCGCAGAAGAAGAACCCGG TCGCACTGGAGACCATCAGGAAGGCCGCCGGTCCTGCCGTGACGTGGCTGAGCGCGGCGCTGGCCACGTTCCGCGCGGAA GGGACCGGCGACCAGGCCATGCGTAGCGTCTCACATATCGACGAGGCCTTGGCAACGACAGAAAGCATGCTCGATCTGTT CACTGGCGTCATGGAAACGCTGATCGTGCATCAGGACCACATGGCCGAATCGCTCAAGGGAAGCTGGTGCACCGCGAGCA ATCTGGCGGACGTCGTCGTGCGTGAACGACGTCTGTCCTTCCGCCAGGTGCACCACATCGTCGCCCGTGCGGTGCGCAAC TGCGTGGCGCAAGGACTGCGTCCCGATCAGTTGACCAGCAGCCGTCTCGATGAGGCAGCTCTCGAAACGGTGGGTATCGC GCTGAATCTGGGCGACGCGGCGGTACGTGATGCGCTCGATCCGGTTCGCTTTGTCGAAACCCGGATTACGGAAGGCAGCG TCGGGCCGCAGCAGGTTGCGCGACTGCTCGAACGCGCGGCGCAAGAACGCGCTGCGGATCGCCAATGGGTCAGCGAGGCG CGCGGCCGACTGAGTCGATCGCAACTGGCACTCAATGAAGCCGTGAGCAAGCTGGTTGCCTGA
Upstream 100 bases:
>100_bases GCTTGCAGCGCGCGGGGCGAGGCCCCCGTCTGAACCGCATTATTGCTGGGTAGAGAAGCGCCGTCCGCATGGCCAGGCGC CGATTGCCTCGCTTGTTACC
Downstream 100 bases:
>100_bases GAACCAGCGTGACGCTTACGAAAAAATACCGAAGGAGACGCTGGTTATGTTGAAGTCGAAGTCCTTTGCCTTGTTTATGT CCCTCGCGGCACTCTCCCTG
Product: fumarate lyase
Products: NA
Alternate protein names: ASAL 1; Arginosuccinase 1 [H]
Number of amino acids: Translated: 500; Mature: 499
Protein sequence:
>500_residues MTSTPHETLLAEARLSSPPASRLTKHYALPGLERERRQFHEFVAVDLAHTTMLVEQGILSAETGRAILEQLLIIRRMQPS AFPVDVRKGSLLLQIESYLFGAIGEDVGGQMHTGRSRIDQGATVRRLYKRNRMLDVMDQLNVFQEAIAEQARHHAHTIMP GYTHMQQAQPWVFGHYLLSFSSRLHDSFERLAQAYGRVNRNPLGTVGLAGTSWPLNRERTTELLGFDGQIENSKLGREAF DAADAICALSFIMADLNDLATDLHIWSSAEFGLVESDDSYCGTSSIFPQKKNPVALETIRKAAGPAVTWLSAALATFRAE GTGDQAMRSVSHIDEALATTESMLDLFTGVMETLIVHQDHMAESLKGSWCTASNLADVVVRERRLSFRQVHHIVARAVRN CVAQGLRPDQLTSSRLDEAALETVGIALNLGDAAVRDALDPVRFVETRITEGSVGPQQVARLLERAAQERAADRQWVSEA RGRLSRSQLALNEAVSKLVA
Sequences:
>Translated_500_residues MTSTPHETLLAEARLSSPPASRLTKHYALPGLERERRQFHEFVAVDLAHTTMLVEQGILSAETGRAILEQLLIIRRMQPS AFPVDVRKGSLLLQIESYLFGAIGEDVGGQMHTGRSRIDQGATVRRLYKRNRMLDVMDQLNVFQEAIAEQARHHAHTIMP GYTHMQQAQPWVFGHYLLSFSSRLHDSFERLAQAYGRVNRNPLGTVGLAGTSWPLNRERTTELLGFDGQIENSKLGREAF DAADAICALSFIMADLNDLATDLHIWSSAEFGLVESDDSYCGTSSIFPQKKNPVALETIRKAAGPAVTWLSAALATFRAE GTGDQAMRSVSHIDEALATTESMLDLFTGVMETLIVHQDHMAESLKGSWCTASNLADVVVRERRLSFRQVHHIVARAVRN CVAQGLRPDQLTSSRLDEAALETVGIALNLGDAAVRDALDPVRFVETRITEGSVGPQQVARLLERAAQERAADRQWVSEA RGRLSRSQLALNEAVSKLVA >Mature_499_residues TSTPHETLLAEARLSSPPASRLTKHYALPGLERERRQFHEFVAVDLAHTTMLVEQGILSAETGRAILEQLLIIRRMQPSA FPVDVRKGSLLLQIESYLFGAIGEDVGGQMHTGRSRIDQGATVRRLYKRNRMLDVMDQLNVFQEAIAEQARHHAHTIMPG YTHMQQAQPWVFGHYLLSFSSRLHDSFERLAQAYGRVNRNPLGTVGLAGTSWPLNRERTTELLGFDGQIENSKLGREAFD AADAICALSFIMADLNDLATDLHIWSSAEFGLVESDDSYCGTSSIFPQKKNPVALETIRKAAGPAVTWLSAALATFRAEG TGDQAMRSVSHIDEALATTESMLDLFTGVMETLIVHQDHMAESLKGSWCTASNLADVVVRERRLSFRQVHHIVARAVRNC VAQGLRPDQLTSSRLDEAALETVGIALNLGDAAVRDALDPVRFVETRITEGSVGPQQVARLLERAAQERAADRQWVSEAR GRLSRSQLALNEAVSKLVA
Specific function: Arginine biosynthesis; eighth (last) step. [C]
COG id: COG0165
COG function: function code E; Argininosuccinate lyase
Gene ontology:
Cell location: Cytoplasm [H]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the lyase 1 family. Argininosuccinate lyase subfamily [H]
Homologues:
Organism=Homo sapiens, GI31541964, Length=311, Percent_Identity=32.475884244373, Blast_Score=141, Evalue=1e-33, Organism=Homo sapiens, GI68303542, Length=311, Percent_Identity=32.475884244373, Blast_Score=141, Evalue=1e-33, Organism=Homo sapiens, GI68303547, Length=309, Percent_Identity=32.6860841423948, Blast_Score=139, Evalue=8e-33, Organism=Homo sapiens, GI68303549, Length=311, Percent_Identity=30.5466237942122, Blast_Score=120, Evalue=3e-27, Organism=Escherichia coli, GI1790398, Length=421, Percent_Identity=30.4038004750594, Blast_Score=164, Evalue=1e-41, Organism=Saccharomyces cerevisiae, GI6321806, Length=327, Percent_Identity=35.474006116208, Blast_Score=170, Evalue=5e-43, Organism=Drosophila melanogaster, GI221473854, Length=318, Percent_Identity=32.7044025157233, Blast_Score=151, Evalue=1e-36, Organism=Drosophila melanogaster, GI78706858, Length=318, Percent_Identity=32.7044025157233, Blast_Score=151, Evalue=1e-36,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR009049 - InterPro: IPR003031 - InterPro: IPR000362 - InterPro: IPR008948 - InterPro: IPR022761 [H]
Pfam domain/function: PF00206 Lyase_1 [H]
EC number: =4.3.2.1 [H]
Molecular weight: Translated: 55250; Mature: 55119
Theoretical pI: Translated: 6.66; Mature: 6.66
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.8 %Cys (Translated Protein) 2.6 %Met (Translated Protein) 3.4 %Cys+Met (Translated Protein) 0.8 %Cys (Mature Protein) 2.4 %Met (Mature Protein) 3.2 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MTSTPHETLLAEARLSSPPASRLTKHYALPGLERERRQFHEFVAVDLAHTTMLVEQGILS CCCCCHHHHHHHHHCCCCCHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCHH AETGRAILEQLLIIRRMQPSAFPVDVRKGSLLLQIESYLFGAIGEDVGGQMHTGRSRIDQ HHHHHHHHHHHHHHHHCCCCCCCEECCCCCEEEEHHHHHHHHHHHHCCCCCCCCHHHHHC GATVRRLYKRNRMLDVMDQLNVFQEAIAEQARHHAHTIMPGYTHMQQAQPWVFGHYLLSF CHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHCCCHHHHHHHHHH SSRLHDSFERLAQAYGRVNRNPLGTVGLAGTSWPLNRERTTELLGFDGQIENSKLGREAF HHHHHHHHHHHHHHHCCCCCCCCCCEECCCCCCCCCHHHHHHHHCCCCCCCCCCCCHHHH DAADAICALSFIMADLNDLATDLHIWSSAEFGLVESDDSYCGTSSIFPQKKNPVALETIR HHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCEECCCCCCCCCCCCCCCCCCHHHHHHH KAAGPAVTWLSAALATFRAEGTGDQAMRSVSHIDEALATTESMLDLFTGVMETLIVHQDH HHCCHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH MAESLKGSWCTASNLADVVVRERRLSFRQVHHIVARAVRNCVAQGLRPDQLTSSRLDEAA HHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHH LETVGIALNLGDAAVRDALDPVRFVETRITEGSVGPQQVARLLERAAQERAADRQWVSEA HHHHHHHEECCHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHH RGRLSRSQLALNEAVSKLVA HHHHHHHHHHHHHHHHHHCC >Mature Secondary Structure TSTPHETLLAEARLSSPPASRLTKHYALPGLERERRQFHEFVAVDLAHTTMLVEQGILS CCCCHHHHHHHHHCCCCCHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCHH AETGRAILEQLLIIRRMQPSAFPVDVRKGSLLLQIESYLFGAIGEDVGGQMHTGRSRIDQ HHHHHHHHHHHHHHHHCCCCCCCEECCCCCEEEEHHHHHHHHHHHHCCCCCCCCHHHHHC GATVRRLYKRNRMLDVMDQLNVFQEAIAEQARHHAHTIMPGYTHMQQAQPWVFGHYLLSF CHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHCCCHHHHHHHHHH SSRLHDSFERLAQAYGRVNRNPLGTVGLAGTSWPLNRERTTELLGFDGQIENSKLGREAF HHHHHHHHHHHHHHHCCCCCCCCCCEECCCCCCCCCHHHHHHHHCCCCCCCCCCCCHHHH DAADAICALSFIMADLNDLATDLHIWSSAEFGLVESDDSYCGTSSIFPQKKNPVALETIR HHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCEECCCCCCCCCCCCCCCCCCHHHHHHH KAAGPAVTWLSAALATFRAEGTGDQAMRSVSHIDEALATTESMLDLFTGVMETLIVHQDH HHCCHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH MAESLKGSWCTASNLADVVVRERRLSFRQVHHIVARAVRNCVAQGLRPDQLTSSRLDEAA HHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHH LETVGIALNLGDAAVRDALDPVRFVETRITEGSVGPQQVARLLERAAQERAADRQWVSEA HHHHHHHEECCHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHH RGRLSRSQLALNEAVSKLVA HHHHHHHHHHHHHHHHHHCC
PDB accession: NA
Resolution: NA
Structure class: Alpha
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: NA