Definition Buchnera aphidicola str. Cc (Cinara cedri), complete genome.
Accession NC_008513
Length 416,380

Click here to switch to the map view.

The map label for this gene is argH

Identifier: 116514978

GI number: 116514978

Start: 35658

End: 37040

Strand: Direct

Name: argH

Synonym: BCc_033

Alternate gene names: 116514978

Gene position: 35658-37040 (Clockwise)

Preceding gene: 116514977

Following gene: 116514982

Centisome position: 8.56

GC content: 23.72

Gene sequence:

>1383_bases
ATGTCTTTATGGGGTGGAAGATTTACAAAAATCTCTAATACTGAATTTGATAGTTTTAATAATTCTTTACGTATAGATCA
TAGATTAATAAAAGATGATATTAAATCTTCAATTGCATGGTCAAAAATATTATTAGATGTACAAGTTTTAACTAAAAAAG
AACAAAAAATTATAGAGAACACATTATTATCAATTTTAAAAAAAAATAAAAATAATTTTACTAAAATATTATCTTCAAAT
TCAGAGGATATTCATAGTTGGTTAGAAACTACTGTAATTAATACAATAGGTGATTTAGGAAAAAAATTATATACAGGTAG
AAGTCGTAATGATCAAATTGCAACAGATTTAAAGCTATGGTGTAAGAGAAAATCAAAAAAAATTTGTAGGAGAATTATTC
AATTACAAAATGATTTTTTGGATAATGCATATTTACATATAAATACTATTATTCCTGGATATACTCATTTGCAAAGAGCT
CAACCTATTACATTTTCTTATTGGTGTTTAGCATATATTGAAATGTTAGAAAGAGATCGATTACGAATTTTAAACTTGAC
TCAATTTTTGAATTCTTCTCCATTAGGATCCGGCGCTATATCAGGTACATCATGGGAAATTGATAGAAAAAAATTAGCTT
TTTTTATGGGATTTTCAGAGATTACAAAAAATGCTTTAGATAGTGTTTCAGATAGAGATTTTATTTTGGATATTTTATCT
GCTGCTGCTATTAGTATGATGCATTTATCTAGATTTTCAGAAGATTTGATATTTTATAATTCAGGTGAAGCTAATTTTAT
TGAATTATCAGATTCTATTACATCTGGTTCATCATTAATGCCACAAAAAAAGAACCCTGATATTTTAGAACTTATTAGAG
CTAAATGCAGTAGTGTTTATGGTTCTTTATTTTCTATGTTTTCATTATTAAAAGGTTTACCATTGTCTTATAATAAAGAT
TTTCAAGAAGATAAAAATCATTTATTTTCAGGATTAGATATTTGGGAAGATTGTTTAAAGATTAGTAGTTTAGTCTTAAA
AAATATTAAATTAAAAAAATCTAATTGTAAAAAATCAGCACAATTAGGTTATAGTAATGCAACAGAATTAGCTGAATATT
TAGTTAAAAAAGGAATATCTTTTAGAGATTCTCATCATATTACTGGAAAAATTGTTATAGCATCAATTAAAAAAAATAAG
TGTTTAGAAGAATTAGATTTATTATTTTTAAAAAAATATTGTTCAAAAATTGAATCTGATGTATATCAACATCTTTCATT
AGAATCCTGTTTAAATAAAAAAAATTCTATTGGTGGTGTTTCTAATAAACAAATTAAGATTTCTTTAGATCAAGTAAAAA
AACGTTTGAGTACATTTAAATAA

Upstream 100 bases:

>100_bases
ACGCAAAAGGTTTTATTCGTTTGTTTTCTCTATCATCTCGTATTCGAGCATTAAAAAATAAAAAATAATACATAATTATA
TATTTTTTTGAGGTAAATAT

Downstream 100 bases:

>100_bases
ATAAAATATATATTTATATAAGTAAAAATATATTTTTAAATAAATATATATTTAATATCACGCGATATATTATTAATATC
GTGTGATATTAAAATTATTA

Product: hypothetical protein

Products: NA

Alternate protein names: ASAL; Arginosuccinase

Number of amino acids: Translated: 460; Mature: 459

Protein sequence:

>460_residues
MSLWGGRFTKISNTEFDSFNNSLRIDHRLIKDDIKSSIAWSKILLDVQVLTKKEQKIIENTLLSILKKNKNNFTKILSSN
SEDIHSWLETTVINTIGDLGKKLYTGRSRNDQIATDLKLWCKRKSKKICRRIIQLQNDFLDNAYLHINTIIPGYTHLQRA
QPITFSYWCLAYIEMLERDRLRILNLTQFLNSSPLGSGAISGTSWEIDRKKLAFFMGFSEITKNALDSVSDRDFILDILS
AAAISMMHLSRFSEDLIFYNSGEANFIELSDSITSGSSLMPQKKNPDILELIRAKCSSVYGSLFSMFSLLKGLPLSYNKD
FQEDKNHLFSGLDIWEDCLKISSLVLKNIKLKKSNCKKSAQLGYSNATELAEYLVKKGISFRDSHHITGKIVIASIKKNK
CLEELDLLFLKKYCSKIESDVYQHLSLESCLNKKNSIGGVSNKQIKISLDQVKKRLSTFK

Sequences:

>Translated_460_residues
MSLWGGRFTKISNTEFDSFNNSLRIDHRLIKDDIKSSIAWSKILLDVQVLTKKEQKIIENTLLSILKKNKNNFTKILSSN
SEDIHSWLETTVINTIGDLGKKLYTGRSRNDQIATDLKLWCKRKSKKICRRIIQLQNDFLDNAYLHINTIIPGYTHLQRA
QPITFSYWCLAYIEMLERDRLRILNLTQFLNSSPLGSGAISGTSWEIDRKKLAFFMGFSEITKNALDSVSDRDFILDILS
AAAISMMHLSRFSEDLIFYNSGEANFIELSDSITSGSSLMPQKKNPDILELIRAKCSSVYGSLFSMFSLLKGLPLSYNKD
FQEDKNHLFSGLDIWEDCLKISSLVLKNIKLKKSNCKKSAQLGYSNATELAEYLVKKGISFRDSHHITGKIVIASIKKNK
CLEELDLLFLKKYCSKIESDVYQHLSLESCLNKKNSIGGVSNKQIKISLDQVKKRLSTFK
>Mature_459_residues
SLWGGRFTKISNTEFDSFNNSLRIDHRLIKDDIKSSIAWSKILLDVQVLTKKEQKIIENTLLSILKKNKNNFTKILSSNS
EDIHSWLETTVINTIGDLGKKLYTGRSRNDQIATDLKLWCKRKSKKICRRIIQLQNDFLDNAYLHINTIIPGYTHLQRAQ
PITFSYWCLAYIEMLERDRLRILNLTQFLNSSPLGSGAISGTSWEIDRKKLAFFMGFSEITKNALDSVSDRDFILDILSA
AAISMMHLSRFSEDLIFYNSGEANFIELSDSITSGSSLMPQKKNPDILELIRAKCSSVYGSLFSMFSLLKGLPLSYNKDF
QEDKNHLFSGLDIWEDCLKISSLVLKNIKLKKSNCKKSAQLGYSNATELAEYLVKKGISFRDSHHITGKIVIASIKKNKC
LEELDLLFLKKYCSKIESDVYQHLSLESCLNKKNSIGGVSNKQIKISLDQVKKRLSTFK

Specific function: Arginine biosynthesis; eighth (last) step. [C]

COG id: COG0165

COG function: function code E; Argininosuccinate lyase

Gene ontology:

Cell location: Cytoplasm

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the lyase 1 family. Argininosuccinate lyase subfamily

Homologues:

Organism=Homo sapiens, GI31541964, Length=454, Percent_Identity=38.3259911894273, Blast_Score=318, Evalue=7e-87,
Organism=Homo sapiens, GI68303542, Length=454, Percent_Identity=38.3259911894273, Blast_Score=318, Evalue=7e-87,
Organism=Homo sapiens, GI68303549, Length=454, Percent_Identity=36.3436123348018, Blast_Score=288, Evalue=6e-78,
Organism=Homo sapiens, GI68303547, Length=454, Percent_Identity=36.1233480176211, Blast_Score=286, Evalue=2e-77,
Organism=Escherichia coli, GI1790398, Length=457, Percent_Identity=54.9234135667396, Blast_Score=552, Evalue=1e-158,
Organism=Saccharomyces cerevisiae, GI6321806, Length=461, Percent_Identity=37.3101952277657, Blast_Score=311, Evalue=1e-85,
Organism=Drosophila melanogaster, GI221473854, Length=453, Percent_Identity=38.1898454746137, Blast_Score=325, Evalue=5e-89,
Organism=Drosophila melanogaster, GI78706858, Length=453, Percent_Identity=38.1898454746137, Blast_Score=325, Evalue=5e-89,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): ARLY_BUCCC (Q058D5)

Other databases:

- EMBL:   CP000263
- RefSeq:   YP_802607.1
- ProteinModelPortal:   Q058D5
- SMR:   Q058D5
- STRING:   Q058D5
- EnsemblBacteria:   EBBUCT00000001292
- GeneID:   4440708
- GenomeReviews:   CP000263_GR
- KEGG:   bcc:BCc_033
- eggNOG:   COG0165
- GeneTree:   EBGT00050000007810
- HOGENOM:   HBG539632
- OMA:   MAEDLIF
- BioCyc:   BAPH372461:BCC_033-MONOMER
- GO:   GO:0005737
- HAMAP:   MF_00006
- InterPro:   IPR009049
- InterPro:   IPR003031
- InterPro:   IPR000362
- InterPro:   IPR020557
- InterPro:   IPR008948
- InterPro:   IPR022761
- PANTHER:   PTHR11444:SF3
- PRINTS:   PR00145
- PRINTS:   PR00149
- TIGRFAMs:   TIGR00838

Pfam domain/function: PF00206 Lyase_1; SSF48557 L-Aspartase-like

EC number: =4.3.2.1

Molecular weight: Translated: 52510; Mature: 52379

Theoretical pI: Translated: 9.85; Mature: 9.85

Prosite motif: PS00163 FUMARATE_LYASES

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

2.0 %Cys     (Translated Protein)
1.5 %Met     (Translated Protein)
3.5 %Cys+Met (Translated Protein)
2.0 %Cys     (Mature Protein)
1.3 %Met     (Mature Protein)
3.3 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSLWGGRFTKISNTEFDSFNNSLRIDHRLIKDDIKSSIAWSKILLDVQVLTKKEQKIIEN
CCCCCCCCEECCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
TLLSILKKNKNNFTKILSSNSEDIHSWLETTVINTIGDLGKKLYTGRSRNDQIATDLKLW
HHHHHHHHCCHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHH
CKRKSKKICRRIIQLQNDFLDNAYLHINTIIPGYTHLQRAQPITFSYWCLAYIEMLERDR
HHHHHHHHHHHHHHHHHHHCCCCEEEEEECCCCHHHHHHCCCCCHHHHHHHHHHHHHHHH
LRILNLTQFLNSSPLGSGAISGTSWEIDRKKLAFFMGFSEITKNALDSVSDRDFILDILS
HHHHHHHHHHCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHH
AAAISMMHLSRFSEDLIFYNSGEANFIELSDSITSGSSLMPQKKNPDILELIRAKCSSVY
HHHHHHHHHHHHCCCEEEEECCCCCEEEECCCCCCCCCCCCCCCCCCHHHHHHHHHHHHH
GSLFSMFSLLKGLPLSYNKDFQEDKNHLFSGLDIWEDCLKISSLVLKNIKLKKSNCKKSA
HHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCHHHCHHHH
QLGYSNATELAEYLVKKGISFRDSHHITGKIVIASIKKNKCLEELDLLFLKKYCSKIESD
HCCCCCHHHHHHHHHHCCCCCCCCCCCEEEEEEEECHHHHHHHHHHHHHHHHHHHHHHHH
VYQHLSLESCLNKKNSIGGVSNKQIKISLDQVKKRLSTFK
HHHHHHHHHHHCCCCCCCCCCCCEEEEEHHHHHHHHHCCC
>Mature Secondary Structure 
SLWGGRFTKISNTEFDSFNNSLRIDHRLIKDDIKSSIAWSKILLDVQVLTKKEQKIIEN
CCCCCCCEECCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
TLLSILKKNKNNFTKILSSNSEDIHSWLETTVINTIGDLGKKLYTGRSRNDQIATDLKLW
HHHHHHHHCCHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHH
CKRKSKKICRRIIQLQNDFLDNAYLHINTIIPGYTHLQRAQPITFSYWCLAYIEMLERDR
HHHHHHHHHHHHHHHHHHHCCCCEEEEEECCCCHHHHHHCCCCCHHHHHHHHHHHHHHHH
LRILNLTQFLNSSPLGSGAISGTSWEIDRKKLAFFMGFSEITKNALDSVSDRDFILDILS
HHHHHHHHHHCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHH
AAAISMMHLSRFSEDLIFYNSGEANFIELSDSITSGSSLMPQKKNPDILELIRAKCSSVY
HHHHHHHHHHHHCCCEEEEECCCCCEEEECCCCCCCCCCCCCCCCCCHHHHHHHHHHHHH
GSLFSMFSLLKGLPLSYNKDFQEDKNHLFSGLDIWEDCLKISSLVLKNIKLKKSNCKKSA
HHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCHHHCHHHH
QLGYSNATELAEYLVKKGISFRDSHHITGKIVIASIKKNKCLEELDLLFLKKYCSKIESD
HCCCCCHHHHHHHHHHCCCCCCCCCCCEEEEEEEECHHHHHHHHHHHHHHHHHHHHHHHH
VYQHLSLESCLNKKNSIGGVSNKQIKISLDQVKKRLSTFK
HHHHHHHHHHHCCCCCCCCCCCCEEEEEHHHHHHHHHCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA