Definition Vibrio cholerae O395 chromosome 2, complete sequence.
Accession NC_009457
Length 3,024,069

Click here to switch to the map view.

The map label for this gene is purL

Identifier: 147673351

GI number: 147673351

Start: 422589

End: 426482

Strand: Direct

Name: purL

Synonym: VC0395_A0395

Alternate gene names: 147673351

Gene position: 422589-426482 (Clockwise)

Preceding gene: 147673927

Following gene: 147675515

Centisome position: 13.97

GC content: 52.57

Gene sequence:

>3894_bases
ATGAGAATTTTGCGTGGCTCCCCAGCTCTTTCAGAGTTTCGTGTTAACAAGCTCCTGACCGCGTGTCGTGAACAGCAACT
GCCTGTAACCGGTATTTACGCCGAGTTTATGCACTTTGCCGATCTCAAGGCAGAGCTCAATCCGCAAGAGTTGGAAAAGC
TCGAAAAACTGCTCACTTATGGTCCAACCATTCAAGAGCATGAACCGCAAGGTTTACTGCTGTTGGTGACGCCGCGCCCC
GGAACCATCTCACCTTGGTCCTCAAAAGCCACCGATATTGCACACAACTGTGGCCTGCATGGCATCAAGCGCCTTGAGCG
CGGTACGGCTTATTATGTTGAAGCAGAAACGGCGCTGACCGCAGCACAAATCGCAACACTTGAGGCGCTGCTGCATGATC
GAATGATGGAAGTCGTGTTCGCAGAACTCACCGATGCCCAGCAACTGTTCAGCGTAGCAGAGCCTGCGCCTATGAGTCAG
GTCGATGTATTAGCGGGCGGTCGTCGTGCGCTTGAAGAGGCAAACGTTTCCCTTGGTCTGGCATTGGCTGAAGATGAAAT
TGATTATCTGGTTGAGAGCTTCACTAAACTGGGTCGTAATCCTAACGACATTGAACTGATGATGTTTGCACAGGCGAACT
CAGAGCACTGCCGCCACAAGATTTTCAACGCCGATTGGACCATTGATGGAGTTAAGCAAGACAAGTCACTGTTCAAAATG
ATCAAAAACACCTTTGAACAGACGCCGGATTATGTGCTTTCGGCTTATAAAGATAATGCCGCAGTAATGACGGGCTCGAC
CGTTGGCCGTTTCTTCCCCGACCCCGAGAGCCGTCAGTACACTTATCACCATGAAGATGCCCACATTCTGATGAAAGTGG
AAACGCATAACCACCCAACGGCGATTTCGCCTTGGCCGGGGGCTTCGACTGGTTCTGGCGGTGAAATTCGTGATGAGGGC
GCAACCGGTATTGGCGGCAAGCCTAAAGCGGGATTGGTGGGCTTTACCACCTCGAACTTGCGTATTCCCGGTTTTGAACA
GCCATGGGAAAGCGATTTTGGTAAGCCAAGCCGCATTGTGAATGCGCTGGATATCATGCTGGAAGGGCCACTCGGCGGCG
CGGCGTTCAACAACGAATTTGGTCGCCCGAACCTACTTGGGTATTTCCGCACTTATGAAGAAAAAGTGACGTCACATGCT
GGTGAAGAGGTGCGTGGTTATCACAAGCCGATCATGATTGCCGGCGGTATGGGTAACATTCGCGCCGAGCATATTCAGAA
GAAAGAGATCCCAGTGGGGGCAAAACTGATCGTACTCGGAGGCCCTGCGATGAACATCGGTCTCGGTGGTGGCGCAGCCT
CTTCGATGGCTTCTGGCCAGTCTGCTGAAGATCTGGATTTTGCTTCTGTGCAGCGTGAAAACCCAGAGATGGAGCGCCGC
TGTCAGGAAGTGATTGACCGTTGTTGGCAGCTCGGTGACAAAAACCCGATCGCCTTTATCCACGATGTGGGCGCGGGTGG
TATCTCTAACGCTCTGCCTGAGCTGGTGAATGACGGCGATCGCGGTGGTAAATTCCAGTTGCGCAACGTGCCGAATGATG
AGCCGGGCATGAGCCCATTGGAAATCTGGTGTAATGAATCACAAGAGCGTTATGTGCTGGCGGTTGCTGCGGAAGATATG
CCGCTGTTTGATGCGATTTGCCAGCGTGAACGCGCCCCTTATGCCGTGGTAGGTGAAGCGACCGAAGAGCGCCATTTGAC
GCTGGAAGACAGCCACTTTGCTAACACGCCGATTGATATGCCAATGGATATTCTGTTGGGTAAGCCGCCGAAAATGCATC
GTGAAGCGAGCACGCTGAAAGTTTCAAGCCCAGCGCTAGAGCGTTCAGGCATTGAGCTTAATGAAGCGGTGGATCGCGTA
CTGCGTTTACCGGCAGTCGCAGAAAAAACGTTCCTGATCACCATTGGTGACCGCTCAGTGACTGGCTTAGTCGCGCGGGA
TCAAATGGTCGGCCCATGGCAAGTTCCCGTCGCAAACTGCGCAGTAACGGCCGCGAGTTTTGATTCTTACCACGGCGAAG
CGATGTCTATGGGTGAGCGTACCCCTGTTGCGCTGTTGGATTTCGGTGCCTCTGCACGTTTAGCGGTCGGTGAAGCTATT
ACCAACATAGCCGCAACCGATATTGGCGAGCTGAAACGCATCAAACTTTCGGCGAACTGGATGTCTCCAGCGGGCCATCC
GGGTGAAGATGCCGGTCTGTATGAAGCGGTGAAAGCGGTCGGTGAAGAGCTTTGTCCTGCACTGGGTATCACTATCCCAG
TCGGTAAAGACTCGATGTCGATGAAAACCAAGTGGCAGGAAAATGGCGAGCAGAAAGAAGTGACTTCGCCGCTGTCACTC
ATCATCACCGCCTTTGCACGTGTGGAAGACATTCGCAAGACCGTGACCCCACAACTGCGTACTGACCTTGGTGAGACAAG
CTTAATCTTGATTGACTTGGGGAATGGTCAAAATCGTCTTGGCGCAACCGCATTGGCGCAAGTGTACAAACAGTTGGGTG
ATAAGCCGGCTGATGTGGATAACGCGGCGCAGCTCAAAGGCTTTTTTGATGCAGTACAAACGCTGGTGCGTAACGACAAG
CTGGTGGCTTACCACGACAAAGGTGACGGCGGTTTATTGGTGACGTTGGCAGAAATGGCTTTCGCGGGTCACTGTGGTAT
TAAAGCCAATATTGAAACCTTGGGTGATGATGCACTGGCGGCACTGTTCAATGAAGAGCTTGGCGCCGTGGTTCAAGTGA
AAAATGATGAGCTGAATGCTGTTCTGGCAACACTTGCCGCCCATGGTTTAGAAGCGTGTGCTCACGTGATTGGTGAAGTA
GAAGCATCCGATCGTCTGCTGATCACTTGTGGTGAGGAAGTCTTGATTGAGCGCTCTCGTACTGAGCTTCGCACCATCTG
GGCGGAAATGACCCATAAGATGCAAGCGCTGCGTGATAACTCGGCGTGTGCTGATCAAGAGTTTGCGGCCAAACAAGATA
ACCGTGACCCGGGCTTGAATGCGAAGTTAACTTACGATGTGCAAGCCGACGTTGCTGCGCCGTACATCGCCAAAGGTGTG
CGTCCGAAAATGGCGATTTTGCGTGAGCAAGGCGTCAACTCACACGTTGAGATGGCGGCAGCGTTTGACCGCGCTGGTTT
TGATGCGGTTGATGTGCATATGAGCGACATTCTGACTGGGCAAACCGTGCTCGATGCTTACCAAGGTCTGGTGGCTTGTG
GTGGCTTCTCTTACGGCGACGTATTGGGTGCGGGCGAAGGTTGGGCGAAATCGATTCTGTTTAACGCCCAAGCGCGTGAG
CAGTTTGAGCAGTTCTTCCAACGTAAAGATACTTTCTCACTTGGGGTGTGTAACGGCTGTCAAATGCTGTCTAACCTGCG
TGATTTGATCCCGGGTGCTGAGCTATGGCCACGTTTTGTGCGTAACGAATCGGATCGTTTTGAAGCGCGCTTTAGCTTAG
TCGAAGTGCAAAAATCGCCATCGCTGTTCTTTAGCGAGATGGCGGGCTCAAGAATGCCGATTGCGGTTTCTCATGGTGAA
GGTCGTGTGGAAGTGCGTGATGCTCAGCATCTGGCGGCAATTGAGCAATCTGGCACCGTAGCGATTCGTTTCGTGGATAA
CTTTGGTCAGCCAACCCAAGCTTACCCAAGCAACCCGAACGGTTCACCGAATGCGATTACCGGTTTAACCACTCAAGATG
GCCGTGTGACGATTATGATGCCGCACCCTGAGCGTGTATTCCGTACCGTCGCCAACTCGTGGCACCCTGATAACTGGGGT
GAGAATGGCGCTTGGATGCGTATGTTCCAGAATGCTCGTAAATATTTTGGCTAA

Upstream 100 bases:

>100_bases
TGAAATCGGCATACATTCAACAAATAGAGTTTAATGTGCTGTATTCGAAAGAGTTTATGCCAATTACACCTCAATCAATT
GGACATAGAGACCTAAGCAC

Downstream 100 bases:

>100_bases
TTGATTTAAGCTTAAGCACAACAAAAAGCGCAGAGAACTTCTGCGCTTTTTTCGTTGTCATCCCTAAACCACCGCTTTTA
GCGGTGGTGATTGTCCCTAG

Product: phosphoribosylformylglycinamidine synthase

Products: NA

Alternate protein names: FGAM synthase; FGAMS; Formylglycinamide ribotide amidotransferase; FGARAT; Formylglycinamide ribotide synthetase

Number of amino acids: Translated: 1297; Mature: 1297

Protein sequence:

>1297_residues
MRILRGSPALSEFRVNKLLTACREQQLPVTGIYAEFMHFADLKAELNPQELEKLEKLLTYGPTIQEHEPQGLLLLVTPRP
GTISPWSSKATDIAHNCGLHGIKRLERGTAYYVEAETALTAAQIATLEALLHDRMMEVVFAELTDAQQLFSVAEPAPMSQ
VDVLAGGRRALEEANVSLGLALAEDEIDYLVESFTKLGRNPNDIELMMFAQANSEHCRHKIFNADWTIDGVKQDKSLFKM
IKNTFEQTPDYVLSAYKDNAAVMTGSTVGRFFPDPESRQYTYHHEDAHILMKVETHNHPTAISPWPGASTGSGGEIRDEG
ATGIGGKPKAGLVGFTTSNLRIPGFEQPWESDFGKPSRIVNALDIMLEGPLGGAAFNNEFGRPNLLGYFRTYEEKVTSHA
GEEVRGYHKPIMIAGGMGNIRAEHIQKKEIPVGAKLIVLGGPAMNIGLGGGAASSMASGQSAEDLDFASVQRENPEMERR
CQEVIDRCWQLGDKNPIAFIHDVGAGGISNALPELVNDGDRGGKFQLRNVPNDEPGMSPLEIWCNESQERYVLAVAAEDM
PLFDAICQRERAPYAVVGEATEERHLTLEDSHFANTPIDMPMDILLGKPPKMHREASTLKVSSPALERSGIELNEAVDRV
LRLPAVAEKTFLITIGDRSVTGLVARDQMVGPWQVPVANCAVTAASFDSYHGEAMSMGERTPVALLDFGASARLAVGEAI
TNIAATDIGELKRIKLSANWMSPAGHPGEDAGLYEAVKAVGEELCPALGITIPVGKDSMSMKTKWQENGEQKEVTSPLSL
IITAFARVEDIRKTVTPQLRTDLGETSLILIDLGNGQNRLGATALAQVYKQLGDKPADVDNAAQLKGFFDAVQTLVRNDK
LVAYHDKGDGGLLVTLAEMAFAGHCGIKANIETLGDDALAALFNEELGAVVQVKNDELNAVLATLAAHGLEACAHVIGEV
EASDRLLITCGEEVLIERSRTELRTIWAEMTHKMQALRDNSACADQEFAAKQDNRDPGLNAKLTYDVQADVAAPYIAKGV
RPKMAILREQGVNSHVEMAAAFDRAGFDAVDVHMSDILTGQTVLDAYQGLVACGGFSYGDVLGAGEGWAKSILFNAQARE
QFEQFFQRKDTFSLGVCNGCQMLSNLRDLIPGAELWPRFVRNESDRFEARFSLVEVQKSPSLFFSEMAGSRMPIAVSHGE
GRVEVRDAQHLAAIEQSGTVAIRFVDNFGQPTQAYPSNPNGSPNAITGLTTQDGRVTIMMPHPERVFRTVANSWHPDNWG
ENGAWMRMFQNARKYFG

Sequences:

>Translated_1297_residues
MRILRGSPALSEFRVNKLLTACREQQLPVTGIYAEFMHFADLKAELNPQELEKLEKLLTYGPTIQEHEPQGLLLLVTPRP
GTISPWSSKATDIAHNCGLHGIKRLERGTAYYVEAETALTAAQIATLEALLHDRMMEVVFAELTDAQQLFSVAEPAPMSQ
VDVLAGGRRALEEANVSLGLALAEDEIDYLVESFTKLGRNPNDIELMMFAQANSEHCRHKIFNADWTIDGVKQDKSLFKM
IKNTFEQTPDYVLSAYKDNAAVMTGSTVGRFFPDPESRQYTYHHEDAHILMKVETHNHPTAISPWPGASTGSGGEIRDEG
ATGIGGKPKAGLVGFTTSNLRIPGFEQPWESDFGKPSRIVNALDIMLEGPLGGAAFNNEFGRPNLLGYFRTYEEKVTSHA
GEEVRGYHKPIMIAGGMGNIRAEHIQKKEIPVGAKLIVLGGPAMNIGLGGGAASSMASGQSAEDLDFASVQRENPEMERR
CQEVIDRCWQLGDKNPIAFIHDVGAGGISNALPELVNDGDRGGKFQLRNVPNDEPGMSPLEIWCNESQERYVLAVAAEDM
PLFDAICQRERAPYAVVGEATEERHLTLEDSHFANTPIDMPMDILLGKPPKMHREASTLKVSSPALERSGIELNEAVDRV
LRLPAVAEKTFLITIGDRSVTGLVARDQMVGPWQVPVANCAVTAASFDSYHGEAMSMGERTPVALLDFGASARLAVGEAI
TNIAATDIGELKRIKLSANWMSPAGHPGEDAGLYEAVKAVGEELCPALGITIPVGKDSMSMKTKWQENGEQKEVTSPLSL
IITAFARVEDIRKTVTPQLRTDLGETSLILIDLGNGQNRLGATALAQVYKQLGDKPADVDNAAQLKGFFDAVQTLVRNDK
LVAYHDKGDGGLLVTLAEMAFAGHCGIKANIETLGDDALAALFNEELGAVVQVKNDELNAVLATLAAHGLEACAHVIGEV
EASDRLLITCGEEVLIERSRTELRTIWAEMTHKMQALRDNSACADQEFAAKQDNRDPGLNAKLTYDVQADVAAPYIAKGV
RPKMAILREQGVNSHVEMAAAFDRAGFDAVDVHMSDILTGQTVLDAYQGLVACGGFSYGDVLGAGEGWAKSILFNAQARE
QFEQFFQRKDTFSLGVCNGCQMLSNLRDLIPGAELWPRFVRNESDRFEARFSLVEVQKSPSLFFSEMAGSRMPIAVSHGE
GRVEVRDAQHLAAIEQSGTVAIRFVDNFGQPTQAYPSNPNGSPNAITGLTTQDGRVTIMMPHPERVFRTVANSWHPDNWG
ENGAWMRMFQNARKYFG
>Mature_1297_residues
MRILRGSPALSEFRVNKLLTACREQQLPVTGIYAEFMHFADLKAELNPQELEKLEKLLTYGPTIQEHEPQGLLLLVTPRP
GTISPWSSKATDIAHNCGLHGIKRLERGTAYYVEAETALTAAQIATLEALLHDRMMEVVFAELTDAQQLFSVAEPAPMSQ
VDVLAGGRRALEEANVSLGLALAEDEIDYLVESFTKLGRNPNDIELMMFAQANSEHCRHKIFNADWTIDGVKQDKSLFKM
IKNTFEQTPDYVLSAYKDNAAVMTGSTVGRFFPDPESRQYTYHHEDAHILMKVETHNHPTAISPWPGASTGSGGEIRDEG
ATGIGGKPKAGLVGFTTSNLRIPGFEQPWESDFGKPSRIVNALDIMLEGPLGGAAFNNEFGRPNLLGYFRTYEEKVTSHA
GEEVRGYHKPIMIAGGMGNIRAEHIQKKEIPVGAKLIVLGGPAMNIGLGGGAASSMASGQSAEDLDFASVQRENPEMERR
CQEVIDRCWQLGDKNPIAFIHDVGAGGISNALPELVNDGDRGGKFQLRNVPNDEPGMSPLEIWCNESQERYVLAVAAEDM
PLFDAICQRERAPYAVVGEATEERHLTLEDSHFANTPIDMPMDILLGKPPKMHREASTLKVSSPALERSGIELNEAVDRV
LRLPAVAEKTFLITIGDRSVTGLVARDQMVGPWQVPVANCAVTAASFDSYHGEAMSMGERTPVALLDFGASARLAVGEAI
TNIAATDIGELKRIKLSANWMSPAGHPGEDAGLYEAVKAVGEELCPALGITIPVGKDSMSMKTKWQENGEQKEVTSPLSL
IITAFARVEDIRKTVTPQLRTDLGETSLILIDLGNGQNRLGATALAQVYKQLGDKPADVDNAAQLKGFFDAVQTLVRNDK
LVAYHDKGDGGLLVTLAEMAFAGHCGIKANIETLGDDALAALFNEELGAVVQVKNDELNAVLATLAAHGLEACAHVIGEV
EASDRLLITCGEEVLIERSRTELRTIWAEMTHKMQALRDNSACADQEFAAKQDNRDPGLNAKLTYDVQADVAAPYIAKGV
RPKMAILREQGVNSHVEMAAAFDRAGFDAVDVHMSDILTGQTVLDAYQGLVACGGFSYGDVLGAGEGWAKSILFNAQARE
QFEQFFQRKDTFSLGVCNGCQMLSNLRDLIPGAELWPRFVRNESDRFEARFSLVEVQKSPSLFFSEMAGSRMPIAVSHGE
GRVEVRDAQHLAAIEQSGTVAIRFVDNFGQPTQAYPSNPNGSPNAITGLTTQDGRVTIMMPHPERVFRTVANSWHPDNWG
ENGAWMRMFQNARKYFG

Specific function: Unknown

COG id: COG0046

COG function: function code F; Phosphoribosylformylglycinamidine (FGAM) synthase, synthetase domain

Gene ontology:

Cell location: Cytoplasm

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 glutamine amidotransferase type-1 domain

Homologues:

Organism=Homo sapiens, GI31657129, Length=1270, Percent_Identity=36.6141732283465, Blast_Score=749, Evalue=0.0,
Organism=Escherichia coli, GI48994899, Length=1297, Percent_Identity=74.7108712413261, Blast_Score=2041, Evalue=0.0,
Organism=Caenorhabditis elegans, GI17553022, Length=1340, Percent_Identity=33.4328358208955, Blast_Score=629, Evalue=1e-180,
Organism=Saccharomyces cerevisiae, GI6321498, Length=1364, Percent_Identity=50.733137829912, Blast_Score=1313, Evalue=0.0,
Organism=Drosophila melanogaster, GI24582111, Length=1299, Percent_Identity=36.1816782140108, Blast_Score=720, Evalue=0.0,
Organism=Drosophila melanogaster, GI24582109, Length=1299, Percent_Identity=36.1816782140108, Blast_Score=720, Evalue=0.0,
Organism=Drosophila melanogaster, GI17137292, Length=1299, Percent_Identity=36.1816782140108, Blast_Score=720, Evalue=0.0,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): PUR4_VIBCH (Q9KTN2)

Other databases:

- EMBL:   AE003852
- PIR:   A82272
- RefSeq:   NP_230516.1
- ProteinModelPortal:   Q9KTN2
- GeneID:   2614536
- GenomeReviews:   AE003852_GR
- KEGG:   vch:VC0869
- TIGR:   VC_0869
- HOGENOM:   HBG335309
- OMA:   ERGIAYY
- ProtClustDB:   PRK05297
- BRENDA:   6.3.5.3
- GO:   GO:0005737
- HAMAP:   MF_00419
- InterPro:   IPR000728
- InterPro:   IPR010918
- InterPro:   IPR017926
- InterPro:   IPR010073
- InterPro:   IPR022940
- InterPro:   IPR016188
- TIGRFAMs:   TIGR01735

Pfam domain/function: PF00586 AIRS; PF02769 AIRS_C; SSF56042 AIR_synth_C; SSF55326 PurM_N-like

EC number: =6.3.5.3

Molecular weight: Translated: 141423; Mature: 141423

Theoretical pI: Translated: 4.89; Mature: 4.89

Prosite motif: PS51273 GATASE_TYPE_1

Important sites: ACT_SITE 1137-1137 ACT_SITE 1262-1262 ACT_SITE 1264-1264

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.2 %Cys     (Translated Protein)
3.1 %Met     (Translated Protein)
4.3 %Cys+Met (Translated Protein)
1.2 %Cys     (Mature Protein)
3.1 %Met     (Mature Protein)
4.3 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MRILRGSPALSEFRVNKLLTACREQQLPVTGIYAEFMHFADLKAELNPQELEKLEKLLTY
CCCCCCCCCHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHC
GPTIQEHEPQGLLLLVTPRPGTISPWSSKATDIAHNCGLHGIKRLERGTAYYVEAETALT
CCCCCCCCCCCEEEEEECCCCCCCCCCCCHHHHHHHCCHHHHHHHHCCCEEEEECHHHHH
AAQIATLEALLHDRMMEVVFAELTDAQQLFSVAEPAPMSQVDVLAGGRRALEEANVSLGL
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHCCHHHHHHCCCEEEE
ALAEDEIDYLVESFTKLGRNPNDIELMMFAQANSEHCRHKIFNADWTIDGVKQDKSLFKM
EECHHHHHHHHHHHHHHCCCCCCEEEEEEECCCHHHHHHHHCCCCCEECCCHHHHHHHHH
IKNTFEQTPDYVLSAYKDNAAVMTGSTVGRFFPDPESRQYTYHHEDAHILMKVETHNHPT
HHHHHHCCHHHHHHHHCCCCEEEECCCCCCCCCCCCCCCEEEEECCCEEEEEEEECCCCC
AISPWPGASTGSGGEIRDEGATGIGGKPKAGLVGFTTSNLRIPGFEQPWESDFGKPSRIV
CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCEEEEEECCEECCCCCCCHHHCCCCHHHHH
NALDIMLEGPLGGAAFNNEFGRPNLLGYFRTYEEKVTSHAGEEVRGYHKPIMIAGGMGNI
HHHHHHEECCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHCCHHHHCCCCCEEEECCCCCH
RAEHIQKKEIPVGAKLIVLGGPAMNIGLGGGAASSMASGQSAEDLDFASVQRENPEMERR
HHHHHHHCCCCCCEEEEEECCCEEEEECCCCCHHHHCCCCCCCCCCHHHHHCCCCHHHHH
CQEVIDRCWQLGDKNPIAFIHDVGAGGISNALPELVNDGDRGGKFQLRNVPNDEPGMSPL
HHHHHHHHHHCCCCCCEEEEEECCCCCHHHHHHHHHCCCCCCCEEEECCCCCCCCCCCHH
EIWCNESQERYVLAVAAEDMPLFDAICQRERAPYAVVGEATEERHLTLEDSHFANTPIDM
HHEECCCCCEEEEEEECCCCHHHHHHHHHCCCCEEEEECCCCCCEEEEECCCCCCCCCCC
PMDILLGKPPKMHREASTLKVSSPALERSGIELNEAVDRVLRLPAVAEKTFLITIGDRSV
CHHHHCCCCCCCCCCCCEEEECCCCHHHCCCCHHHHHHHHHHCCCCCCCEEEEEECCCCE
TGLVARDQMVGPWQVPVANCAVTAASFDSYHGEAMSMGERTPVALLDFGASARLAVGEAI
EEEEECCCCCCCCCCCHHHHEEEEHHCCCCCCHHHHCCCCCCEEEEECCCCCHHHHHHHH
TNIAATDIGELKRIKLSANWMSPAGHPGEDAGLYEAVKAVGEELCPALGITIPVGKDSMS
HHHHHCCCCCCEEEEEECCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHCCEEECCCCCCC
MKTKWQENGEQKEVTSPLSLIITAFARVEDIRKTVTPQLRTDLGETSLILIDLGNGQNRL
HHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHCCCCCEEEEEECCCCCCHH
GATALAQVYKQLGDKPADVDNAAQLKGFFDAVQTLVRNDKLVAYHDKGDGGLLVTLAEMA
HHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHCCCCEEEEEECCCCCEEEEEHHHH
FAGHCGIKANIETLGDDALAALFNEELGAVVQVKNDELNAVLATLAAHGLEACAHVIGEV
HHCCCCCEECHHHCCHHHHHHHHHHCCCEEEEECCCHHHHHHHHHHHHHHHHHHHHHHCC
EASDRLLITCGEEVLIERSRTELRTIWAEMTHKMQALRDNSACADQEFAAKQDNRDPGLN
CCCCCEEEEECHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHCCCCCCCCCC
AKLTYDVQADVAAPYIAKGVRPKMAILREQGVNSHVEMAAAFDRAGFDAVDVHMSDILTG
CEEEEEECCCCCCHHHHHCCCHHHHHHHHCCCCHHHHHHHHHHHCCCCEEEEEHHHHHHH
QTVLDAYQGLVACGGFSYGDVLGAGEGWAKSILFNAQAREQFEQFFQRKDTFSLGVCNGC
HHHHHHHHHHHHCCCCCHHCCCCCCCCHHHHHHCCHHHHHHHHHHHHHCCCCEEECCHHH
QMLSNLRDLIPGAELWPRFVRNESDRFEARFSLVEVQKSPSLFFSEMAGSRMPIAVSHGE
HHHHHHHHHCCCHHHHHHHHCCCCHHHHHHHHHEEECCCCHHHHHHHCCCCCCEEEECCC
GRVEVRDAQHLAAIEQSGTVAIRFVDNFGQPTQAYPSNPNGSPNAITGLTTQDGRVTIMM
CEEEEECHHHHHHHHCCCCEEEEEECCCCCCCCCCCCCCCCCCCCEEEEEECCCEEEEEE
PHPERVFRTVANSWHPDNWGENGAWMRMFQNARKYFG
CCHHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHHHCC
>Mature Secondary Structure
MRILRGSPALSEFRVNKLLTACREQQLPVTGIYAEFMHFADLKAELNPQELEKLEKLLTY
CCCCCCCCCHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHC
GPTIQEHEPQGLLLLVTPRPGTISPWSSKATDIAHNCGLHGIKRLERGTAYYVEAETALT
CCCCCCCCCCCEEEEEECCCCCCCCCCCCHHHHHHHCCHHHHHHHHCCCEEEEECHHHHH
AAQIATLEALLHDRMMEVVFAELTDAQQLFSVAEPAPMSQVDVLAGGRRALEEANVSLGL
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHCCHHHHHHCCCEEEE
ALAEDEIDYLVESFTKLGRNPNDIELMMFAQANSEHCRHKIFNADWTIDGVKQDKSLFKM
EECHHHHHHHHHHHHHHCCCCCCEEEEEEECCCHHHHHHHHCCCCCEECCCHHHHHHHHH
IKNTFEQTPDYVLSAYKDNAAVMTGSTVGRFFPDPESRQYTYHHEDAHILMKVETHNHPT
HHHHHHCCHHHHHHHHCCCCEEEECCCCCCCCCCCCCCCEEEEECCCEEEEEEEECCCCC
AISPWPGASTGSGGEIRDEGATGIGGKPKAGLVGFTTSNLRIPGFEQPWESDFGKPSRIV
CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCEEEEEECCEECCCCCCCHHHCCCCHHHHH
NALDIMLEGPLGGAAFNNEFGRPNLLGYFRTYEEKVTSHAGEEVRGYHKPIMIAGGMGNI
HHHHHHEECCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHCCHHHHCCCCCEEEECCCCCH
RAEHIQKKEIPVGAKLIVLGGPAMNIGLGGGAASSMASGQSAEDLDFASVQRENPEMERR
HHHHHHHCCCCCCEEEEEECCCEEEEECCCCCHHHHCCCCCCCCCCHHHHHCCCCHHHHH
CQEVIDRCWQLGDKNPIAFIHDVGAGGISNALPELVNDGDRGGKFQLRNVPNDEPGMSPL
HHHHHHHHHHCCCCCCEEEEEECCCCCHHHHHHHHHCCCCCCCEEEECCCCCCCCCCCHH
EIWCNESQERYVLAVAAEDMPLFDAICQRERAPYAVVGEATEERHLTLEDSHFANTPIDM
HHEECCCCCEEEEEEECCCCHHHHHHHHHCCCCEEEEECCCCCCEEEEECCCCCCCCCCC
PMDILLGKPPKMHREASTLKVSSPALERSGIELNEAVDRVLRLPAVAEKTFLITIGDRSV
CHHHHCCCCCCCCCCCCEEEECCCCHHHCCCCHHHHHHHHHHCCCCCCCEEEEEECCCCE
TGLVARDQMVGPWQVPVANCAVTAASFDSYHGEAMSMGERTPVALLDFGASARLAVGEAI
EEEEECCCCCCCCCCCHHHHEEEEHHCCCCCCHHHHCCCCCCEEEEECCCCCHHHHHHHH
TNIAATDIGELKRIKLSANWMSPAGHPGEDAGLYEAVKAVGEELCPALGITIPVGKDSMS
HHHHHCCCCCCEEEEEECCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHCCEEECCCCCCC
MKTKWQENGEQKEVTSPLSLIITAFARVEDIRKTVTPQLRTDLGETSLILIDLGNGQNRL
HHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHCCCCCEEEEEECCCCCCHH
GATALAQVYKQLGDKPADVDNAAQLKGFFDAVQTLVRNDKLVAYHDKGDGGLLVTLAEMA
HHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHCCCCEEEEEECCCCCEEEEEHHHH
FAGHCGIKANIETLGDDALAALFNEELGAVVQVKNDELNAVLATLAAHGLEACAHVIGEV
HHCCCCCEECHHHCCHHHHHHHHHHCCCEEEEECCCHHHHHHHHHHHHHHHHHHHHHHCC
EASDRLLITCGEEVLIERSRTELRTIWAEMTHKMQALRDNSACADQEFAAKQDNRDPGLN
CCCCCEEEEECHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHCCCCCCCCCC
AKLTYDVQADVAAPYIAKGVRPKMAILREQGVNSHVEMAAAFDRAGFDAVDVHMSDILTG
CEEEEEECCCCCCHHHHHCCCHHHHHHHHCCCCHHHHHHHHHHHCCCCEEEEEHHHHHHH
QTVLDAYQGLVACGGFSYGDVLGAGEGWAKSILFNAQAREQFEQFFQRKDTFSLGVCNGC
HHHHHHHHHHHHCCCCCHHCCCCCCCCHHHHHHCCHHHHHHHHHHHHHCCCCEEECCHHH
QMLSNLRDLIPGAELWPRFVRNESDRFEARFSLVEVQKSPSLFFSEMAGSRMPIAVSHGE
HHHHHHHHHCCCHHHHHHHHCCCCHHHHHHHHHEEECCCCHHHHHHHCCCCCCEEEECCC
GRVEVRDAQHLAAIEQSGTVAIRFVDNFGQPTQAYPSNPNGSPNAITGLTTQDGRVTIMM
CEEEEECHHHHHHHHCCCCEEEEEECCCCCCCCCCCCCCCCCCCCEEEEEECCCEEEEEE
PHPERVFRTVANSWHPDNWGENGAWMRMFQNARKYFG
CCHHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 10952301