Definition Nostoc sp. PCC 7120, complete genome.
Accession NC_003272
Length 6,413,771

Click here to switch to the map view.

The map label for this gene is speA

Identifier: 17230893

GI number: 17230893

Start: 4111552

End: 4113591

Strand: Reverse

Name: speA

Synonym: all3401

Alternate gene names: 17230893

Gene position: 4113591-4111552 (Counterclockwise)

Preceding gene: 17230895

Following gene: 17230890

Centisome position: 64.14

GC content: 45.93

Gene sequence:

>2040_bases
GTGAAACACAGAGGTCAGGAAGAAATGGGTGTTGAGTCAACTGCTACATCTGACGAGGTGGTGAAAGTACCAGCCAACGG
AAACAAGTTGGAGGGGAAAAATCACAAGCAGAAAAAGCTGCTACCAACGAATACGCCAGGAGATGTATCTCGCGTTTGGA
AGATTGAGGACAGCGAAGCTTTATACCGGATTGAAGGTTGGGGACAGCCTTATTTCTCGATTAATGCGGCTGGTCACGTC
ACTGTTTCTCCCAAAGGCGATCGCGGCGGTTCTTTGGATTTGTTTGAATTGGTCAATGCTTTGAAACAACGCAGTTTGGG
TTTGCCCTTACTGATTCGTTTTTCGGATATTTTAGAAGACCGCATTGAACGCTTAAATGCTTGTTTTGCCAAGGCGATCG
CTCGCTACAATTACCCTGGTGTATATCGGGGTGTGTTTCCTGTGAAGTGCAACCAGCAACGGCATTTGATTGAGGATTTA
GTGAGATTTGGCAGGCCACATCAGTTTGGTTTAGAAGCTGGTTCCAAGCCAGAATTAATGATTGCTTTGGCGTTGTTGGA
TACCCCTGGATCTTTGCTAATTTGCAACGGCTACAAAGACCGGGAGTATGTGGAAACAGCCATGTTATCCCAAAGACTAG
GGCAAACGCCAATTATCGTCCTAGAACAGGTGGAAGAGGTCGATTTAGTGATTGCGGCTAGTCACCAATTAGGAATTAAA
CCGATTTTGGGAGTAAGAGCGAAATTAAGCACCCAAGGCATGGGACGCTGGGGTACATCCACAGGCGATCGCGCTAAATT
TGGTTTGACGATTCCTGAAATCATCCAAGCAGTTGACAAGCTCCGCGATGCTGACTTGCTGGATTCTTTACAGCTAATGC
ACTTCCATATTGGTTCGCAAATCTCCGCCATCAATGTGATTAAAGATGCCATCCAAGAAGCTAGCCGGATTTACGTAGAG
CTAGCATCCTTGGGAGCAAATATGAAATACCTGGATGTTGGCGGCGGCTTAGGTGTAGACTATGACGGTTCCCAGACCAA
CTTCTACGCCTCCAAAAACTACAATATGCAGAACTATGCCAACGACATTGTGGCAGAGTTAAAAGATACCTGTGCAGAGA
AACAAATACCAGTACCAACACTGATTAGTGAAAGTGGACGGGCGATCGCCTCCCATCAATCGGTACTCATTTTTGATGTT
CTCAGTACTAGTGATGTTCCCCGCGATAACCCGGAACCGCCAAAAGAAGGCGAATCCCCAGTTATTAATTACCTGTGGGA
AACTTATCAATCCATCAACAAAGAGAACTATCAAGAGTTCTACCACGACGCTACCCAATTCAAGGAAGAAGCTATTAGCC
GCTTCAATCTGGGGATTTTGCGCCTGAGAGAACGAGCCAAAGCTGAACGTCTTTATTGGGCTTGTTGTCAGAAAATTTTA
GACATCATCCGCCAGCACGATTACGTACCTGATGAGTTGGAAGACCTAGAAAAAATCATGGCTTCCATCTACTACATCAA
TCTTTCCGTGTTCCAATCAGCACCAGATTGTTGGGCGATCGATCAACTATTCCCAATTATGCCCATCCATCGCCTAGATG
AAGAACCAACGCAGCGAGGAATTTTAGCAGACCTCACCTGTGACAGCGATGGCAAAATTGATCGCTTTATCGACCTACGG
GATGTCAAATCTGTGCTAGAACTGCACCCCTTCCAACCAGGGGAACCCTATTATATGGGAATGTTCCTCAATGGTGCTTA
TCAGGAAATTATGGGGAACTTACACAACTTATTCGGCGATACCAACGCCGTTCATATCCAGTTAACCCCCAAAGGCTACC
AAATTGAACACGTGGTCAAAGGCGATACCATGAGTGAAGTGGTGAGCTACGTCCAATATGACTCCGAGGACATGGTAGAA
AACATCCGCCAACGTTGCGAGCGGGCGTTAGAAGAAAAGCGCATTACCTTAGCTGAATCCCAGCGCTTACTCCAGACTTA
CGAACAAAGTCTCAGAAGATACACATACTTAAATAGTTAG

Upstream 100 bases:

>100_bases
CAGTCAACAATTAACTACTGACCAATCAGAGTTTATCTCAGAAATTATCTCTGAGTTCATATCAGTTCTTATACGAATGC
GTTAAATTGTTTATTCGTGG

Downstream 100 bases:

>100_bases
TGGTTAGTGGTTAGTTGTCAGTTGTCAGTAGAAATTGCAACTGACAACTGACTCATGACTAATGACTAAGTTGCGTTTGT
TCCCAACAATTCGGCGATCG

Product: arginine decarboxylase

Products: NA

Alternate protein names: ADC

Number of amino acids: Translated: 679; Mature: 679

Protein sequence:

>679_residues
MKHRGQEEMGVESTATSDEVVKVPANGNKLEGKNHKQKKLLPTNTPGDVSRVWKIEDSEALYRIEGWGQPYFSINAAGHV
TVSPKGDRGGSLDLFELVNALKQRSLGLPLLIRFSDILEDRIERLNACFAKAIARYNYPGVYRGVFPVKCNQQRHLIEDL
VRFGRPHQFGLEAGSKPELMIALALLDTPGSLLICNGYKDREYVETAMLSQRLGQTPIIVLEQVEEVDLVIAASHQLGIK
PILGVRAKLSTQGMGRWGTSTGDRAKFGLTIPEIIQAVDKLRDADLLDSLQLMHFHIGSQISAINVIKDAIQEASRIYVE
LASLGANMKYLDVGGGLGVDYDGSQTNFYASKNYNMQNYANDIVAELKDTCAEKQIPVPTLISESGRAIASHQSVLIFDV
LSTSDVPRDNPEPPKEGESPVINYLWETYQSINKENYQEFYHDATQFKEEAISRFNLGILRLRERAKAERLYWACCQKIL
DIIRQHDYVPDELEDLEKIMASIYYINLSVFQSAPDCWAIDQLFPIMPIHRLDEEPTQRGILADLTCDSDGKIDRFIDLR
DVKSVLELHPFQPGEPYYMGMFLNGAYQEIMGNLHNLFGDTNAVHIQLTPKGYQIEHVVKGDTMSEVVSYVQYDSEDMVE
NIRQRCERALEEKRITLAESQRLLQTYEQSLRRYTYLNS

Sequences:

>Translated_679_residues
MKHRGQEEMGVESTATSDEVVKVPANGNKLEGKNHKQKKLLPTNTPGDVSRVWKIEDSEALYRIEGWGQPYFSINAAGHV
TVSPKGDRGGSLDLFELVNALKQRSLGLPLLIRFSDILEDRIERLNACFAKAIARYNYPGVYRGVFPVKCNQQRHLIEDL
VRFGRPHQFGLEAGSKPELMIALALLDTPGSLLICNGYKDREYVETAMLSQRLGQTPIIVLEQVEEVDLVIAASHQLGIK
PILGVRAKLSTQGMGRWGTSTGDRAKFGLTIPEIIQAVDKLRDADLLDSLQLMHFHIGSQISAINVIKDAIQEASRIYVE
LASLGANMKYLDVGGGLGVDYDGSQTNFYASKNYNMQNYANDIVAELKDTCAEKQIPVPTLISESGRAIASHQSVLIFDV
LSTSDVPRDNPEPPKEGESPVINYLWETYQSINKENYQEFYHDATQFKEEAISRFNLGILRLRERAKAERLYWACCQKIL
DIIRQHDYVPDELEDLEKIMASIYYINLSVFQSAPDCWAIDQLFPIMPIHRLDEEPTQRGILADLTCDSDGKIDRFIDLR
DVKSVLELHPFQPGEPYYMGMFLNGAYQEIMGNLHNLFGDTNAVHIQLTPKGYQIEHVVKGDTMSEVVSYVQYDSEDMVE
NIRQRCERALEEKRITLAESQRLLQTYEQSLRRYTYLNS
>Mature_679_residues
MKHRGQEEMGVESTATSDEVVKVPANGNKLEGKNHKQKKLLPTNTPGDVSRVWKIEDSEALYRIEGWGQPYFSINAAGHV
TVSPKGDRGGSLDLFELVNALKQRSLGLPLLIRFSDILEDRIERLNACFAKAIARYNYPGVYRGVFPVKCNQQRHLIEDL
VRFGRPHQFGLEAGSKPELMIALALLDTPGSLLICNGYKDREYVETAMLSQRLGQTPIIVLEQVEEVDLVIAASHQLGIK
PILGVRAKLSTQGMGRWGTSTGDRAKFGLTIPEIIQAVDKLRDADLLDSLQLMHFHIGSQISAINVIKDAIQEASRIYVE
LASLGANMKYLDVGGGLGVDYDGSQTNFYASKNYNMQNYANDIVAELKDTCAEKQIPVPTLISESGRAIASHQSVLIFDV
LSTSDVPRDNPEPPKEGESPVINYLWETYQSINKENYQEFYHDATQFKEEAISRFNLGILRLRERAKAERLYWACCQKIL
DIIRQHDYVPDELEDLEKIMASIYYINLSVFQSAPDCWAIDQLFPIMPIHRLDEEPTQRGILADLTCDSDGKIDRFIDLR
DVKSVLELHPFQPGEPYYMGMFLNGAYQEIMGNLHNLFGDTNAVHIQLTPKGYQIEHVVKGDTMSEVVSYVQYDSEDMVE
NIRQRCERALEEKRITLAESQRLLQTYEQSLRRYTYLNS

Specific function: Catalyzes the biosynthesis of agmatine from arginine

COG id: COG1166

COG function: function code E; Arginine decarboxylase (spermidine biosynthesis)

Gene ontology:

Cell location: Periplasmic Protein [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the Orn/Lys/Arg decarboxylase class-II family. SpeA subfamily

Homologues:

Organism=Escherichia coli, GI1789307, Length=626, Percent_Identity=40.2555910543131, Blast_Score=494, Evalue=1e-141,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): SPEA_NOSS1 (Q8YRP3)

Other databases:

- EMBL:   BA000019
- PIR:   AB2231
- RefSeq:   NP_487441.1
- ProteinModelPortal:   Q8YRP3
- STRING:   Q8YRP3
- GeneID:   1106999
- GenomeReviews:   BA000019_GR
- KEGG:   ana:all3401
- NMPDR:   fig|103690.1.peg.3708
- eggNOG:   COG1166
- HOGENOM:   HBG321436
- OMA:   TCDSDGE
- PhylomeDB:   Q8YRP3
- ProtClustDB:   PRK05354
- BioCyc:   NSP103690:ALL3401-MONOMER
- HAMAP:   MF_01417
- InterPro:   IPR009006
- InterPro:   IPR002985
- InterPro:   IPR022643
- InterPro:   IPR022657
- InterPro:   IPR022644
- InterPro:   IPR022653
- InterPro:   IPR000183
- PANTHER:   PTHR11482:SF3
- PIRSF:   PIRSF001336
- PRINTS:   PR01180
- PRINTS:   PR01179
- TIGRFAMs:   TIGR01273

Pfam domain/function: PF02784 Orn_Arg_deC_N; PF00278 Orn_DAP_Arg_deC; SSF50621 Racem_decarbox_C

EC number: =4.1.1.19

Molecular weight: Translated: 76822; Mature: 76822

Theoretical pI: Translated: 5.14; Mature: 5.14

Prosite motif: PS00878 ODR_DC_2_1; PS00879 ODR_DC_2_2

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.3 %Cys     (Translated Protein)
2.2 %Met     (Translated Protein)
3.5 %Cys+Met (Translated Protein)
1.3 %Cys     (Mature Protein)
2.2 %Met     (Mature Protein)
3.5 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKHRGQEEMGVESTATSDEVVKVPANGNKLEGKNHKQKKLLPTNTPGDVSRVWKIEDSEA
CCCCCCHHCCCCCCCCCCCEEEECCCCCCCCCCCCCCCCCCCCCCCCCCHHEEEECCCCC
LYRIEGWGQPYFSINAAGHVTVSPKGDRGGSLDLFELVNALKQRSLGLPLLIRFSDILED
EEEEECCCCCEEEEECCEEEEECCCCCCCCCCHHHHHHHHHHHHCCCCCEEHHHHHHHHH
RIERLNACFAKAIARYNYPGVYRGVFPVKCNQQRHLIEDLVRFGRPHQFGLEAGSKPELM
HHHHHHHHHHHHHHHCCCCCCCCCEEEEECCCHHHHHHHHHHHCCCCEECCCCCCCCCEE
IALALLDTPGSLLICNGYKDREYVETAMLSQRLGQTPIIVLEQVEEVDLVIAASHQLGIK
EEEEEECCCCCEEEECCCCCHHHHHHHHHHHHHCCCCEEEHHHHHHCEEEEEECCCCCCC
PILGVRAKLSTQGMGRWGTSTGDRAKFGLTIPEIIQAVDKLRDADLLDSLQLMHFHIGSQ
HHHCCHHHHCCCCCCCCCCCCCCCCEECCCHHHHHHHHHHHCCHHHHHHHHHHHHHHCCC
ISAINVIKDAIQEASRIYVELASLGANMKYLDVGGGLGVDYDGSQTNFYASKNYNMQNYA
HHHHHHHHHHHHHHHHHHHHHHHCCCCCEEEECCCCCCCCCCCCCCEEEECCCCCHHHHH
NDIVAELKDTCAEKQIPVPTLISESGRAIASHQSVLIFDVLSTSDVPRDNPEPPKEGESP
HHHHHHHHHHHHHCCCCCCHHHCCCCCEECCCCCEEEEEEECCCCCCCCCCCCCCCCCCH
VINYLWETYQSINKENYQEFYHDATQFKEEAISRFNLGILRLRERAKAERLYWACCQKIL
HHHHHHHHHHHHCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
DIIRQHDYVPDELEDLEKIMASIYYINLSVFQSAPDCWAIDQLFPIMPIHRLDEEPTQRG
HHHHHCCCCCHHHHHHHHHHHHHHHEEHHHHHCCCCCEEHHHHHHCCCHHHCCCCHHHCC
ILADLTCDSDGKIDRFIDLRDVKSVLELHPFQPGEPYYMGMFLNGAYQEIMGNLHNLFGD
CEEEEECCCCCCHHHHCCHHHHHHHHHHCCCCCCCCEEEEEEECHHHHHHHHHHHHHCCC
TNAVHIQLTPKGYQIEHVVKGDTMSEVVSYVQYDSEDMVENIRQRCERALEEKRITLAES
CCEEEEEECCCCCEEEEEECCCCHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHH
QRLLQTYEQSLRRYTYLNS
HHHHHHHHHHHHHHHCCCC
>Mature Secondary Structure
MKHRGQEEMGVESTATSDEVVKVPANGNKLEGKNHKQKKLLPTNTPGDVSRVWKIEDSEA
CCCCCCHHCCCCCCCCCCCEEEECCCCCCCCCCCCCCCCCCCCCCCCCCHHEEEECCCCC
LYRIEGWGQPYFSINAAGHVTVSPKGDRGGSLDLFELVNALKQRSLGLPLLIRFSDILED
EEEEECCCCCEEEEECCEEEEECCCCCCCCCCHHHHHHHHHHHHCCCCCEEHHHHHHHHH
RIERLNACFAKAIARYNYPGVYRGVFPVKCNQQRHLIEDLVRFGRPHQFGLEAGSKPELM
HHHHHHHHHHHHHHHCCCCCCCCCEEEEECCCHHHHHHHHHHHCCCCEECCCCCCCCCEE
IALALLDTPGSLLICNGYKDREYVETAMLSQRLGQTPIIVLEQVEEVDLVIAASHQLGIK
EEEEEECCCCCEEEECCCCCHHHHHHHHHHHHHCCCCEEEHHHHHHCEEEEEECCCCCCC
PILGVRAKLSTQGMGRWGTSTGDRAKFGLTIPEIIQAVDKLRDADLLDSLQLMHFHIGSQ
HHHCCHHHHCCCCCCCCCCCCCCCCEECCCHHHHHHHHHHHCCHHHHHHHHHHHHHHCCC
ISAINVIKDAIQEASRIYVELASLGANMKYLDVGGGLGVDYDGSQTNFYASKNYNMQNYA
HHHHHHHHHHHHHHHHHHHHHHHCCCCCEEEECCCCCCCCCCCCCCEEEECCCCCHHHHH
NDIVAELKDTCAEKQIPVPTLISESGRAIASHQSVLIFDVLSTSDVPRDNPEPPKEGESP
HHHHHHHHHHHHHCCCCCCHHHCCCCCEECCCCCEEEEEEECCCCCCCCCCCCCCCCCCH
VINYLWETYQSINKENYQEFYHDATQFKEEAISRFNLGILRLRERAKAERLYWACCQKIL
HHHHHHHHHHHHCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
DIIRQHDYVPDELEDLEKIMASIYYINLSVFQSAPDCWAIDQLFPIMPIHRLDEEPTQRG
HHHHHCCCCCHHHHHHHHHHHHHHHEEHHHHHCCCCCEEHHHHHHCCCHHHCCCCHHHCC
ILADLTCDSDGKIDRFIDLRDVKSVLELHPFQPGEPYYMGMFLNGAYQEIMGNLHNLFGD
CEEEEECCCCCCHHHHCCHHHHHHHHHHCCCCCCCCEEEEEEECHHHHHHHHHHHHHCCC
TNAVHIQLTPKGYQIEHVVKGDTMSEVVSYVQYDSEDMVENIRQRCERALEEKRITLAES
CCEEEEEECCCCCEEEEEECCCCHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHH
QRLLQTYEQSLRRYTYLNS
HHHHHHHHHHHHHHHCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 11759840