Definition Mesorhizobium loti MAFF303099 plasmid pMLa, complete sequence.
Accession NC_002679
Length 351,911

Click here to switch to the map view.

The map label for this gene is eryA [H]

Identifier: 13488204

GI number: 13488204

Start: 48469

End: 53811

Strand: Direct

Name: eryA [H]

Synonym: mlr9053

Alternate gene names: 13488204

Gene position: 48469-53811 (Clockwise)

Preceding gene: 13488203

Following gene: 13488367

Centisome position: 13.77

GC content: 62.08

Gene sequence:

>5343_bases
ATGAACGGCCCCATTCACAGAGCTACCCCCATCGCGATTATTGGAATGGCCTGCCGGTTCCCCAATGCTGATACGCCCAA
GGCATTCTGGGAAAACATTGTTGCCGGGCGCGAGAGCGTTCGTGAGTTGTCGGATGTTGAACTCGCCGGCGCGGGCGTCG
AGCCCGAGGAGTGGGAAGCGGACGATTATATCCGCCGCGGCGCCCCTCTTACGGGCCTCGGCTACTTCGACGCTGACTTC
TTCAGCATCACGCCTCGTGAGGCGGCTCTCCTCGATCCGCAGCACCGACTATTCCTGGAAAACATTTGGCACGCCATCGA
AGATGCTGGCTACGCCGTCCGTTCGACCGAGATGACGACGGGCATCTATGCTGGCTCCGGCCCGAGCAGCTATTTCGCCA
GATGCGTAGCCGGCTTGCATGATTTCCGCAAGGAAGGCATGCTCGACTCCATGTCCGGCTTCCAGGCCATGCTGGGAAAC
GACAAGGATTACCTGGCGACTCGGGCGGCCCATCGCCTCAACCTCATCGGTCCCGCCATCAACGTCCAAACAGCTTGTTC
AACCTCACTCGTAAGTCTCCATCTAGCCTGCAGCGGTCTTCAGAACGGCGAATGCGACCTGGCGCTGGCGGGCGGTGTCA
CGGCAATCGTTCCCGACGGTGCTGGCTATCGCTATCAAGAGGGCATGATCTTGTCCCGCGACGGGCACTGCCGTCCGTTC
GATGCCGATGCCAGCGGCACGGTGTTTTCGAGTGGCGTCGGTGTGCTTGCGCTTCGAAGACTCGATGACGCGCTTGCCGA
TGGTGATACCATTCACGCTGTTATTCGCGGTTCGGCGATCAACAATGATGGAAACGACAAGATCAGCTTCTCGGCGCCGA
GCATCGAGGGCCAATCGAGCGTCGTCGCAAGAGCACTGATGAACAGTTCAATCGCGCCGGAAACGATTTCCTACATGGAG
ACTCACGGAACGGGCACGAAACTGGGTGATCCGATCGAGATCGAAGCCCTCCGCGAAGTCTTCGCCGGCTTTCCGGCGGA
CGTCGCACCGATCACCCTTGGTTCGGTGAAGGCCAATATCGGCCATACGATCGCCGCTTCCGGCGTCGCGGGTGTTATCA
AGACCGTCATGGCACTGAAGTCGCGAACCTTGCCGCCAGCGGTCAATTTCAAGACGCCCAATCCGGAAATCGACTTCGAT
CGCCTTCCCTTCGCCGTGCCGGCGAGCGCTGTGCCCTGGAAGTCCGAGGGTCCGCGACGCGCGGGCATCAGTTCGTTCGG
CGTGGGCGGAACGAATGCCCATGTCATTTTGGAGGAAGCACCGGGCCAGACGAACGGTTCATCTCAGCCGGACGATACGC
CGCACCCCCCCGACGTACCTCGTACGCTGAACATTTCGGCACGCACGCCACAGGCCCTGGCCACCGTGGCCAAGAGTTTT
GCCTTGCGACTCGATATGGCACAGCCCGACGAGCGCGACACCATCTGCTTCACCGCGAACACCGCCCGCCGCGCTTTTGA
GTATCGGCGTTTCGCGACCGGTCGGACAACTAGGGAGTTGGCCGAGAGTCTTCGCGCAAGCGATCATGCCCGCGTCGATG
TCTCCAAACACGTGGTTCCCGCCGCCCTGTTCACCGGACAGGGCGGCCAGGGCGAAGCTATGGGGCGCGGGCTCTACGAG
AGCGATCCGATCTTCCGCAAAGTCTTCGACGCCTGTGACGCGGTGGTCGCACCGCTTCGCAAACACGGATTGGGCGACAT
CCTTTACGGCGACGGGACGCTCGCCCATTTCGTTCACGACACCGAATATACCCAGCCCGCCCTGTTCGCGATCGAACTCG
CACTCGCCCGAGTTCTCGAGGCTAGGGGCTTCGTCCCAGAGATCGTCATGGGACACAGCATTGGAGAATACGTGGCGGCC
CATCTTGCCGGCGTGTTCTCACTCGAGGACGGGCTAAAGCTGATCACCAAGCGCGGCGAACTGATGGGTCGGCTTCCTCG
CAATGGCGGCATGGTCGTCCTGACGGCTGATCCGGACACAGCCACTCAGATGATCCGGGACAGCGAAGTCGAGCTCGCCA
TCGCGGCCGAGAACGGACCAACCAGTACGGTGGTCGCGGGCGAGACTGACGCACTTGAAACGCTGATCAAGGTCGCCAAG
GAAAAAGGCGTCCGCACGGCGCAGTTGAAGGTCTCGCACGCCTTTCATTCGCATCTCATGGATCCAATCCTCGAACAGTT
TGAGGCGTTCGCGAGCACCCTCGATTTTTCCAAGCCCGACGGCCGACTGATAAGCGCGAAGACTGGCAAGGTCGCCGGCG
AGGAAGTCGCCGATGCGCGCTATTGGACCGACCACGTTCGCCAGCCCGTCCTGTTCCATCAGGGCATGATGACTGCGCAG
GAAATTGGGGCGAATCTCTTCCTCGAAATCGGACCGCACCCGGTCCTCACGCCGATGGCGCAGGCGGCCCTAGATGGCAT
TGCCTCGCAGTCGCAATTCGTCTCGAGCCTCAATCGCACCCGCAACGACGAAGAGGTTCTCGCCGAGACGGCGGGCCGCC
TTTTCCTCGCCGGCCTTACGATCAATACGCTCATCGATCTGCCGGATAATGAACGCCGGCTCGTCGATCTTCCGCTCTAT
CCCTTCGAACGTCAGCATCACTGGATCGAAACGAGAGCGAGCGACCGGCTGGCATGGCACTGCCGCCGCGAATGGCACGC
GGAAAAGCAGTCAGCGCCGCAACCGCCGAAAGACAAGGCCCTCTGGATTATCCTGGGCAATGCCCTTGGTCTCGCCGGAC
GCTTAGCTCAGGCGATCGAGAAGCGGGAAGGGCCGGAACAGACAGCGGTCGTTCTTTCGAATGTCGACACAGGTCTCACA
GGCGGTGTGCTCGACGCGCATGTCGCGGGGATCATCGTCACCCCTGAGAGCGCGGAAGGCGCGTCAAGTGGACAGATCGG
CGAGGCGGCGCACAGCCACGCCGCCACCCTCATGCAGTTCGTCCAGACGGTTCAGGCAGCCACTAAGAATGGCAATCTGG
CGAAGGCGAAGATTTGGGTCGTCGGCCAGTCCGGCCGTGCCGTGCCGCAAACAGACACACCAATTCCGTACGCCGCTCGT
CCAGCCTCACTGGTCAGCGCCTCACTGCATGGCATGGCGATGGTGCTCGCGAGCGAACATCCCGATCTGTGGGGGGGCGA
CATCGATCTCGGCGCGGAGCCGAGCGACGCAGAAATCGCGGTCGCGATCGGCATTCTCGTCGGTGGCTCTGGGTCGGAGA
CCGCCTACGCCGTGCGCGGCGAGGAACGCTACGTCCTGCGCCTCAGCGAAAGCGGCGATGTCGGTACGGATTGCCCGGTC
GATCCGCAGAAGATCTATCTCGTCACCGGCGGGCTTGGCGCTCTCGGATCGCTAATGGTCGAATGGCTGATCAATCGCGG
TGCGCGCCGCCTCGTGCTTCTCAACAGGGACGTCGCGGACGGGGCCAAACAGGAACGGCTTGAAGCCCTGCGCCGTTTAG
GCGCTGAGATCGCGGCGCATGCGGTTGACATCGCCGACCAAGTCGGAGTCGAGCGAATCCTGGGCGATCTCTCGGAGGCG
GGCCATCAACTCGGCGGGATCATCCACACCGCCGGCGTCGTTCAGGACGCCACGCTCGGGTCGATCAAGGAGGCGAGCGA
ACTCGAACATGCACTCCGGGCTAAGCTCCAGGGTACACTCATTCTCGACAAGGCGAGCCGTCGCTTCTCACCCGACTTCT
TCGTCTGCTTCTCCTCGGTTAGCGCGCTTCTCGGTATGAAGGGCCAGGCGGCTTACGTGGCGGCCAATGCCGCCATGAAC
CGCATCGTCGAGGGCCGCAACGCCGAGGGGCTGCCAGGTGTCAGCATCGAATGGGGCCCGTGGGCGGAAACCGGTATGGC
ATCCGGACTCGACGAGCGTCTGCGCAAGCGCCTAACCGATTTCGGCCTGCTCGCGATCCGCAACCGGGAGGCGCTCGAGC
GGCTGGAGAGCCTGTGCGCCTCAACTGGGACGCTCACCGCAGCGCCGATCCTGTGGCGACGTTTCTGCAAGAAGCAGTAC
GGGCAGACGCCGGCTTGGCTCACGCCTCTGTCGAATGTGCAGAAGAATCCCCAGGCGGCCAATGACGACGAGGCGACAGA
TCCACTTGCGCGGCTCTTCGGCCCGGTCGCACCGAGCGATCGCAGTCAGGCGATCGAAAGCTTCCTACGCGGAGAGGTCG
CCCGTGTGCTCGGCATCGCCGATCCGGACTGCCTGCCGATGGACGAAGCGCTCAACCAGATGGGATTCGACTCCTTGGCT
ACAATTGAGTTCCGCAACGAACTTGCCAAGACCGGCATCAAGGTCTCGCTCCAGAAGCTCGTGATGGGTGCCTCAATCGC
GGAGATCGCGGCCGATACTGAGACGCAGGTGACCGCCGCTGTCGGGGGCGATGCGGATGGCGAGGCGGTACCAACCGCGC
CGTTCTTGGCCGACAGTGCCCAGGGCTACGACAAGAGCGCGGTGATCATTCCGCGTCCGAAGCCCGACGCGCCGATCCGC
CTGATCGGCTTTCCCTATGCCGGCGGCGGCCCGCTCGTATTCCAGCGCTGGATCGACAGGATGCCGGATCACATAGAGTT
CGGCATCCTGCAGATGCCAGGCCGCAGCGCGCGCCTGGAAGAGGGCTTCTGGATGCGGATGGAGGACATGGTCGACGGCA
TCGTGCCGGAGATGCTGCCCTTCCTTAAGGAAAAACCCTTCGCCTTCCTCGGGTTTTGCTATGGCGGCGTCCAGGCCTTC
GAGATTGCCCAGCGGGTGCGCCGCGATCACGGGCTGGAGCCGGAACACTTCTTCGTGGCCGGTGGTCGCTCGCCACAGAT
TTACAATAACGACCAGTTCGCCATCGACGTCCAGCAGTTCAATCACGAGACCGGCAAATCCGAACACGAACTCGACGAGA
GCGCGTTCGTCGAGATGCTGAAGGAGGTAAATTTCGCCAACAACAAGGCGCTGTTCGAAGATCCCGAATTGCGCGCGATG
ATGCTTCCGATTATCCGAGCGGACTACGAGATAAACAACGCCTATCGCTACGGTTTCCATCCTCCGCTCGACGCCCCAAT
CACAGCGATAGGAGGCCGCATCGACCCCTATGTTACGGGCGACCACATTATCGGCTGGAAAGAGCATACCACGAAGCAGT
TCAAGGCGCATTTTTGCGCCGGCGGTCACTTTTTCATGGAACCCCAGATCGAACTCCTTACGCGCATCGCGATCGAAGAC
CTCGAGCCAGTCGTCCAGCGTCTGGCCGCAGATGGCGAGCGCCAGCTGGCTGTGATGAGCTGA

Upstream 100 bases:

>100_bases
TCTCCGCGCTGATCCTGGGCAGCGATGACCCCTCCAGCAGATCAGATTAGCGCGCTCCGGAAGCCAAAAAGCAGATAAAC
GGACCAGCGACGAGGCAAAA

Downstream 100 bases:

>100_bases
CCACGACCACCGGCTTCAGTCCCGCTCGGCAAGCCATGTCCGCGGCGCCGGCCTGGCACTCCCAGGGGCGAACTCGGGTC
AACTGGATTGTTTACCGCTC

Product: polyketide synthase

Products: NA

Alternate protein names: 6-deoxyerythronolide B synthase III; DEBS 3; ORF 3 [H]

Number of amino acids: Translated: 1780; Mature: 1780

Protein sequence:

>1780_residues
MNGPIHRATPIAIIGMACRFPNADTPKAFWENIVAGRESVRELSDVELAGAGVEPEEWEADDYIRRGAPLTGLGYFDADF
FSITPREAALLDPQHRLFLENIWHAIEDAGYAVRSTEMTTGIYAGSGPSSYFARCVAGLHDFRKEGMLDSMSGFQAMLGN
DKDYLATRAAHRLNLIGPAINVQTACSTSLVSLHLACSGLQNGECDLALAGGVTAIVPDGAGYRYQEGMILSRDGHCRPF
DADASGTVFSSGVGVLALRRLDDALADGDTIHAVIRGSAINNDGNDKISFSAPSIEGQSSVVARALMNSSIAPETISYME
THGTGTKLGDPIEIEALREVFAGFPADVAPITLGSVKANIGHTIAASGVAGVIKTVMALKSRTLPPAVNFKTPNPEIDFD
RLPFAVPASAVPWKSEGPRRAGISSFGVGGTNAHVILEEAPGQTNGSSQPDDTPHPPDVPRTLNISARTPQALATVAKSF
ALRLDMAQPDERDTICFTANTARRAFEYRRFATGRTTRELAESLRASDHARVDVSKHVVPAALFTGQGGQGEAMGRGLYE
SDPIFRKVFDACDAVVAPLRKHGLGDILYGDGTLAHFVHDTEYTQPALFAIELALARVLEARGFVPEIVMGHSIGEYVAA
HLAGVFSLEDGLKLITKRGELMGRLPRNGGMVVLTADPDTATQMIRDSEVELAIAAENGPTSTVVAGETDALETLIKVAK
EKGVRTAQLKVSHAFHSHLMDPILEQFEAFASTLDFSKPDGRLISAKTGKVAGEEVADARYWTDHVRQPVLFHQGMMTAQ
EIGANLFLEIGPHPVLTPMAQAALDGIASQSQFVSSLNRTRNDEEVLAETAGRLFLAGLTINTLIDLPDNERRLVDLPLY
PFERQHHWIETRASDRLAWHCRREWHAEKQSAPQPPKDKALWIILGNALGLAGRLAQAIEKREGPEQTAVVLSNVDTGLT
GGVLDAHVAGIIVTPESAEGASSGQIGEAAHSHAATLMQFVQTVQAATKNGNLAKAKIWVVGQSGRAVPQTDTPIPYAAR
PASLVSASLHGMAMVLASEHPDLWGGDIDLGAEPSDAEIAVAIGILVGGSGSETAYAVRGEERYVLRLSESGDVGTDCPV
DPQKIYLVTGGLGALGSLMVEWLINRGARRLVLLNRDVADGAKQERLEALRRLGAEIAAHAVDIADQVGVERILGDLSEA
GHQLGGIIHTAGVVQDATLGSIKEASELEHALRAKLQGTLILDKASRRFSPDFFVCFSSVSALLGMKGQAAYVAANAAMN
RIVEGRNAEGLPGVSIEWGPWAETGMASGLDERLRKRLTDFGLLAIRNREALERLESLCASTGTLTAAPILWRRFCKKQY
GQTPAWLTPLSNVQKNPQAANDDEATDPLARLFGPVAPSDRSQAIESFLRGEVARVLGIADPDCLPMDEALNQMGFDSLA
TIEFRNELAKTGIKVSLQKLVMGASIAEIAADTETQVTAAVGGDADGEAVPTAPFLADSAQGYDKSAVIIPRPKPDAPIR
LIGFPYAGGGPLVFQRWIDRMPDHIEFGILQMPGRSARLEEGFWMRMEDMVDGIVPEMLPFLKEKPFAFLGFCYGGVQAF
EIAQRVRRDHGLEPEHFFVAGGRSPQIYNNDQFAIDVQQFNHETGKSEHELDESAFVEMLKEVNFANNKALFEDPELRAM
MLPIIRADYEINNAYRYGFHPPLDAPITAIGGRIDPYVTGDHIIGWKEHTTKQFKAHFCAGGHFFMEPQIELLTRIAIED
LEPVVQRLAADGERQLAVMS

Sequences:

>Translated_1780_residues
MNGPIHRATPIAIIGMACRFPNADTPKAFWENIVAGRESVRELSDVELAGAGVEPEEWEADDYIRRGAPLTGLGYFDADF
FSITPREAALLDPQHRLFLENIWHAIEDAGYAVRSTEMTTGIYAGSGPSSYFARCVAGLHDFRKEGMLDSMSGFQAMLGN
DKDYLATRAAHRLNLIGPAINVQTACSTSLVSLHLACSGLQNGECDLALAGGVTAIVPDGAGYRYQEGMILSRDGHCRPF
DADASGTVFSSGVGVLALRRLDDALADGDTIHAVIRGSAINNDGNDKISFSAPSIEGQSSVVARALMNSSIAPETISYME
THGTGTKLGDPIEIEALREVFAGFPADVAPITLGSVKANIGHTIAASGVAGVIKTVMALKSRTLPPAVNFKTPNPEIDFD
RLPFAVPASAVPWKSEGPRRAGISSFGVGGTNAHVILEEAPGQTNGSSQPDDTPHPPDVPRTLNISARTPQALATVAKSF
ALRLDMAQPDERDTICFTANTARRAFEYRRFATGRTTRELAESLRASDHARVDVSKHVVPAALFTGQGGQGEAMGRGLYE
SDPIFRKVFDACDAVVAPLRKHGLGDILYGDGTLAHFVHDTEYTQPALFAIELALARVLEARGFVPEIVMGHSIGEYVAA
HLAGVFSLEDGLKLITKRGELMGRLPRNGGMVVLTADPDTATQMIRDSEVELAIAAENGPTSTVVAGETDALETLIKVAK
EKGVRTAQLKVSHAFHSHLMDPILEQFEAFASTLDFSKPDGRLISAKTGKVAGEEVADARYWTDHVRQPVLFHQGMMTAQ
EIGANLFLEIGPHPVLTPMAQAALDGIASQSQFVSSLNRTRNDEEVLAETAGRLFLAGLTINTLIDLPDNERRLVDLPLY
PFERQHHWIETRASDRLAWHCRREWHAEKQSAPQPPKDKALWIILGNALGLAGRLAQAIEKREGPEQTAVVLSNVDTGLT
GGVLDAHVAGIIVTPESAEGASSGQIGEAAHSHAATLMQFVQTVQAATKNGNLAKAKIWVVGQSGRAVPQTDTPIPYAAR
PASLVSASLHGMAMVLASEHPDLWGGDIDLGAEPSDAEIAVAIGILVGGSGSETAYAVRGEERYVLRLSESGDVGTDCPV
DPQKIYLVTGGLGALGSLMVEWLINRGARRLVLLNRDVADGAKQERLEALRRLGAEIAAHAVDIADQVGVERILGDLSEA
GHQLGGIIHTAGVVQDATLGSIKEASELEHALRAKLQGTLILDKASRRFSPDFFVCFSSVSALLGMKGQAAYVAANAAMN
RIVEGRNAEGLPGVSIEWGPWAETGMASGLDERLRKRLTDFGLLAIRNREALERLESLCASTGTLTAAPILWRRFCKKQY
GQTPAWLTPLSNVQKNPQAANDDEATDPLARLFGPVAPSDRSQAIESFLRGEVARVLGIADPDCLPMDEALNQMGFDSLA
TIEFRNELAKTGIKVSLQKLVMGASIAEIAADTETQVTAAVGGDADGEAVPTAPFLADSAQGYDKSAVIIPRPKPDAPIR
LIGFPYAGGGPLVFQRWIDRMPDHIEFGILQMPGRSARLEEGFWMRMEDMVDGIVPEMLPFLKEKPFAFLGFCYGGVQAF
EIAQRVRRDHGLEPEHFFVAGGRSPQIYNNDQFAIDVQQFNHETGKSEHELDESAFVEMLKEVNFANNKALFEDPELRAM
MLPIIRADYEINNAYRYGFHPPLDAPITAIGGRIDPYVTGDHIIGWKEHTTKQFKAHFCAGGHFFMEPQIELLTRIAIED
LEPVVQRLAADGERQLAVMS
>Mature_1780_residues
MNGPIHRATPIAIIGMACRFPNADTPKAFWENIVAGRESVRELSDVELAGAGVEPEEWEADDYIRRGAPLTGLGYFDADF
FSITPREAALLDPQHRLFLENIWHAIEDAGYAVRSTEMTTGIYAGSGPSSYFARCVAGLHDFRKEGMLDSMSGFQAMLGN
DKDYLATRAAHRLNLIGPAINVQTACSTSLVSLHLACSGLQNGECDLALAGGVTAIVPDGAGYRYQEGMILSRDGHCRPF
DADASGTVFSSGVGVLALRRLDDALADGDTIHAVIRGSAINNDGNDKISFSAPSIEGQSSVVARALMNSSIAPETISYME
THGTGTKLGDPIEIEALREVFAGFPADVAPITLGSVKANIGHTIAASGVAGVIKTVMALKSRTLPPAVNFKTPNPEIDFD
RLPFAVPASAVPWKSEGPRRAGISSFGVGGTNAHVILEEAPGQTNGSSQPDDTPHPPDVPRTLNISARTPQALATVAKSF
ALRLDMAQPDERDTICFTANTARRAFEYRRFATGRTTRELAESLRASDHARVDVSKHVVPAALFTGQGGQGEAMGRGLYE
SDPIFRKVFDACDAVVAPLRKHGLGDILYGDGTLAHFVHDTEYTQPALFAIELALARVLEARGFVPEIVMGHSIGEYVAA
HLAGVFSLEDGLKLITKRGELMGRLPRNGGMVVLTADPDTATQMIRDSEVELAIAAENGPTSTVVAGETDALETLIKVAK
EKGVRTAQLKVSHAFHSHLMDPILEQFEAFASTLDFSKPDGRLISAKTGKVAGEEVADARYWTDHVRQPVLFHQGMMTAQ
EIGANLFLEIGPHPVLTPMAQAALDGIASQSQFVSSLNRTRNDEEVLAETAGRLFLAGLTINTLIDLPDNERRLVDLPLY
PFERQHHWIETRASDRLAWHCRREWHAEKQSAPQPPKDKALWIILGNALGLAGRLAQAIEKREGPEQTAVVLSNVDTGLT
GGVLDAHVAGIIVTPESAEGASSGQIGEAAHSHAATLMQFVQTVQAATKNGNLAKAKIWVVGQSGRAVPQTDTPIPYAAR
PASLVSASLHGMAMVLASEHPDLWGGDIDLGAEPSDAEIAVAIGILVGGSGSETAYAVRGEERYVLRLSESGDVGTDCPV
DPQKIYLVTGGLGALGSLMVEWLINRGARRLVLLNRDVADGAKQERLEALRRLGAEIAAHAVDIADQVGVERILGDLSEA
GHQLGGIIHTAGVVQDATLGSIKEASELEHALRAKLQGTLILDKASRRFSPDFFVCFSSVSALLGMKGQAAYVAANAAMN
RIVEGRNAEGLPGVSIEWGPWAETGMASGLDERLRKRLTDFGLLAIRNREALERLESLCASTGTLTAAPILWRRFCKKQY
GQTPAWLTPLSNVQKNPQAANDDEATDPLARLFGPVAPSDRSQAIESFLRGEVARVLGIADPDCLPMDEALNQMGFDSLA
TIEFRNELAKTGIKVSLQKLVMGASIAEIAADTETQVTAAVGGDADGEAVPTAPFLADSAQGYDKSAVIIPRPKPDAPIR
LIGFPYAGGGPLVFQRWIDRMPDHIEFGILQMPGRSARLEEGFWMRMEDMVDGIVPEMLPFLKEKPFAFLGFCYGGVQAF
EIAQRVRRDHGLEPEHFFVAGGRSPQIYNNDQFAIDVQQFNHETGKSEHELDESAFVEMLKEVNFANNKALFEDPELRAM
MLPIIRADYEINNAYRYGFHPPLDAPITAIGGRIDPYVTGDHIIGWKEHTTKQFKAHFCAGGHFFMEPQIELLTRIAIED
LEPVVQRLAADGERQLAVMS

Specific function: Catalyzes The Condensation Reaction Of Fatty Acid Synthesis By The Addition To An Acyl Acceptor Of Two Carbons From Malonyl-Acp. Has A Preference For Short Chain Acid Substrates And May Function To Supply The Octanoic Substrates For Lipoic Acid Biosynthe

COG id: COG3321

COG function: function code Q; Polyketide synthase modules and related proteins

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 2 acyl carrier domains [H]

Homologues:

Organism=Homo sapiens, GI41872631, Length=887, Percent_Identity=26.9447576099211, Blast_Score=253, Evalue=1e-66,
Organism=Homo sapiens, GI8923559, Length=270, Percent_Identity=30.7407407407407, Blast_Score=114, Evalue=6e-25,
Organism=Homo sapiens, GI89257335, Length=247, Percent_Identity=28.7449392712551, Blast_Score=89, Evalue=5e-17,
Organism=Homo sapiens, GI223972627, Length=174, Percent_Identity=32.7586206896552, Blast_Score=82, Evalue=3e-15,
Organism=Escherichia coli, GI1787337, Length=270, Percent_Identity=27.7777777777778, Blast_Score=96, Evalue=2e-20,
Organism=Escherichia coli, GI1788663, Length=272, Percent_Identity=29.0441176470588, Blast_Score=88, Evalue=5e-18,
Organism=Escherichia coli, GI1787334, Length=302, Percent_Identity=26.8211920529801, Blast_Score=74, Evalue=7e-14,
Organism=Caenorhabditis elegans, GI17550940, Length=900, Percent_Identity=29, Blast_Score=326, Evalue=8e-89,
Organism=Caenorhabditis elegans, GI212642053, Length=880, Percent_Identity=27.7272727272727, Blast_Score=275, Evalue=1e-73,
Organism=Caenorhabditis elegans, GI71983541, Length=276, Percent_Identity=31.8840579710145, Blast_Score=107, Evalue=8e-23,
Organism=Caenorhabditis elegans, GI71983535, Length=265, Percent_Identity=32.4528301886792, Blast_Score=104, Evalue=4e-22,
Organism=Saccharomyces cerevisiae, GI6320904, Length=280, Percent_Identity=27.1428571428571, Blast_Score=84, Evalue=2e-16,
Organism=Drosophila melanogaster, GI24581345, Length=875, Percent_Identity=25.8285714285714, Blast_Score=235, Evalue=2e-61,
Organism=Drosophila melanogaster, GI221330659, Length=887, Percent_Identity=25.9301014656144, Blast_Score=224, Evalue=3e-58,
Organism=Drosophila melanogaster, GI19920632, Length=887, Percent_Identity=25.9301014656144, Blast_Score=224, Evalue=5e-58,
Organism=Drosophila melanogaster, GI24644341, Length=275, Percent_Identity=32.7272727272727, Blast_Score=108, Evalue=3e-23,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR001227
- InterPro:   IPR009081
- InterPro:   IPR014043
- InterPro:   IPR016035
- InterPro:   IPR000794
- InterPro:   IPR002198
- InterPro:   IPR018201
- InterPro:   IPR014031
- InterPro:   IPR014030
- InterPro:   IPR016036
- InterPro:   IPR016040
- InterPro:   IPR006163
- InterPro:   IPR020842
- InterPro:   IPR020801
- InterPro:   IPR020841
- InterPro:   IPR020806
- InterPro:   IPR020802
- InterPro:   IPR015083
- InterPro:   IPR006162
- InterPro:   IPR001031
- InterPro:   IPR016039
- InterPro:   IPR016038 [H]

Pfam domain/function: PF00698 Acyl_transf_1; PF00106 adh_short; PF08990 Docking; PF00109 ketoacyl-synt; PF02801 Ketoacyl-synt_C; PF00550 PP-binding; PF00975 Thioesterase [H]

EC number: =2.3.1.94 [H]

Molecular weight: Translated: 191781; Mature: 191781

Theoretical pI: Translated: 5.09; Mature: 5.09

Prosite motif: PS50075 ACP_DOMAIN ; PS00013 PROKAR_LIPOPROTEIN ; PS00606 B_KETOACYL_SYNTHASE

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.9 %Cys     (Translated Protein)
2.3 %Met     (Translated Protein)
3.2 %Cys+Met (Translated Protein)
0.9 %Cys     (Mature Protein)
2.3 %Met     (Mature Protein)
3.2 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MNGPIHRATPIAIIGMACRFPNADTPKAFWENIVAGRESVRELSDVELAGAGVEPEEWEA
CCCCCCCCCCEEEEEEEECCCCCCCHHHHHHHHHHHHHHHHHHHCCCEECCCCCCCCCCC
DDYIRRGAPLTGLGYFDADFFSITPREAALLDPQHRLFLENIWHAIEDAGYAVRSTEMTT
HHHHHCCCCCCCCCCCCCCCEEECCCHHHHCCHHHHHHHHHHHHHHHHCCCEEEECCCEE
GIYAGSGPSSYFARCVAGLHDFRKEGMLDSMSGFQAMLGNDKDYLATRAAHRLNLIGPAI
EEEECCCCHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHCCCHHHHHHHHHHHHHEECCCC
NVQTACSTSLVSLHLACSGLQNGECDLALAGGVTAIVPDGAGYRYQEGMILSRDGHCRPF
CCHHHHHHHHHHHHHHHCCCCCCCCCEEEECCEEEEEECCCCCEECCCEEECCCCCCCCC
DADASGTVFSSGVGVLALRRLDDALADGDTIHAVIRGSAINNDGNDKISFSAPSIEGQSS
CCCCCCCEECCCHHHHHHHHHHHHHCCCCEEEEEEECCEECCCCCCEEEEECCCCCCHHH
VVARALMNSSIAPETISYMETHGTGTKLGDPIEIEALREVFAGFPADVAPITLGSVKANI
HHHHHHHCCCCCCHHHHHHHHCCCCCCCCCCCHHHHHHHHHCCCCCCCCCEEECCEECCC
GHTIAASGVAGVIKTVMALKSRTLPPAVNFKTPNPEIDFDRLPFAVPASAVPWKSEGPRR
CCHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC
AGISSFGVGGTNAHVILEEAPGQTNGSSQPDDTPHPPDVPRTLNISARTPQALATVAKSF
CCCCCCCCCCCCEEEEEECCCCCCCCCCCCCCCCCCCCCCCEEEECCCCHHHHHHHHHHH
ALRLDMAQPDERDTICFTANTARRAFEYRRFATGRTTRELAESLRASDHARVDVSKHVVP
HEEECCCCCCCCCEEEEECCHHHHHHHHHHHHCCCHHHHHHHHHHCCCCCEEEHHHHHHH
AALFTGQGGQGEAMGRGLYESDPIFRKVFDACDAVVAPLRKHGLGDILYGDGTLAHFVHD
HHEEECCCCCCHHHCCCCCCCCHHHHHHHHHHHHHHHHHHHCCCCCEEECCCCEEEEEEC
TEYTQPALFAIELALARVLEARGFVPEIVMGHSIGEYVAAHLAGVFSLEDGLKLITKRGE
CCCCCHHHHHHHHHHHHHHHHCCCCHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHH
LMGRLPRNGGMVVLTADPDTATQMIRDSEVELAIAAENGPTSTVVAGETDALETLIKVAK
HHHCCCCCCCEEEEECCCCHHHHHHCCCCEEEEEEECCCCCCEEEECCHHHHHHHHHHHH
EKGVRTAQLKVSHAFHSHLMDPILEQFEAFASTLDFSKPDGRLISAKTGKVAGEEVADAR
HCCCEEEEEEHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCEEEECCCCCCCCHHHHHHH
YWTDHVRQPVLFHQGMMTAQEIGANLFLEIGPHPVLTPMAQAALDGIASQSQFVSSLNRT
HHHHHHCCCHHHHHCCHHHHHCCCEEEEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHC
RNDEEVLAETAGRLFLAGLTINTLIDLPDNERRLVDLPLYPFERQHHWIETRASDRLAWH
CCHHHHHHHHCCCEEEEEEEEEEEEECCCCCCEEEECCCCCCCCCCHHHHHCCCCHHHHH
CRREWHAEKQSAPQPPKDKALWIILGNALGLAGRLAQAIEKREGPEQTAVVLSNVDTGLT
HHHHHHHHHHCCCCCCCCCEEEEEECCHHHHHHHHHHHHHHCCCCCHHEEEEECCCCCCC
GGVLDAHVAGIIVTPESAEGASSGQIGEAAHSHAATLMQFVQTVQAATKNGNLAKAKIWV
CCHHHHCEEEEEECCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHCCCCEEEEEEEE
VGQSGRAVPQTDTPIPYAARPASLVSASLHGMAMVLASEHPDLWGGDIDLGAEPSDAEIA
EECCCCCCCCCCCCCCCCCCCHHHHHHHHHHEEEEEECCCCCCCCCCCCCCCCCCCCEEE
VAIGILVGGSGSETAYAVRGEERYVLRLSESGDVGTDCPVDPQKIYLVTGGLGALGSLMV
EEEEEEECCCCCCCEEEEECCCEEEEEEECCCCCCCCCCCCCCEEEEEECCHHHHHHHHH
EWLINRGARRLVLLNRDVADGAKQERLEALRRLGAEIAAHAVDIADQVGVERILGDLSEA
HHHHHCCCCEEEEEECCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
GHQLGGIIHTAGVVQDATLGSIKEASELEHALRAKLQGTLILDKASRRFSPDFFVCFSSV
HHHHCCHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHCCEEEEECCCCCCCCHHHHHHHHH
SALLGMKGQAAYVAANAAMNRIVEGRNAEGLPGVSIEWGPWAETGMASGLDERLRKRLTD
HHHHCCCCCCEEEEHHHHHHHHHCCCCCCCCCCCEECCCCCCHHHHHCCHHHHHHHHHHH
FGLLAIRNREALERLESLCASTGTLTAAPILWRRFCKKQYGQTPAWLTPLSNVQKNPQAA
CCEEEECCHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHCCCCCCCCCHHHHCCCCCCC
NDDEATDPLARLFGPVAPSDRSQAIESFLRGEVARVLGIADPDCLPMDEALNQMGFDSLA
CCCCCCCHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHCCCCCCCCCHHHHHHHCCCCCEE
TIEFRNELAKTGIKVSLQKLVMGASIAEIAADTETQVTAAVGGDADGEAVPTAPFLADSA
HHHHHHHHHHCCHHHHHHHHHHCCHHHHHHCCCCCEEEEEECCCCCCCCCCCCCCCCCCC
QGYDKSAVIIPRPKPDAPIRLIGFPYAGGGPLVFQRWIDRMPDHIEFGILQMPGRSARLE
CCCCCCEEEEECCCCCCCEEEEECCCCCCCHHHHHHHHHHCCCCEEECEEECCCCCCCCC
EGFWMRMEDMVDGIVPEMLPFLKEKPFAFLGFCYGGVQAFEIAQRVRRDHGLEPEHFFVA
CCHHEEHHHHHHHHHHHHHHHHHCCCCEEEHHHHHHHHHHHHHHHHHHHCCCCCCEEEEE
GGRSPQIYNNDQFAIDVQQFNHETGKSEHELDESAFVEMLKEVNFANNKALFEDPELRAM
CCCCCCEECCCEEEEEHHHHCCCCCCCHHHCCHHHHHHHHHHCCCCCCCCCCCCCCHHHH
MLPIIRADYEINNAYRYGFHPPLDAPITAIGGRIDPYVTGDHIIGWKEHTTKQFKAHFCA
HHHHHHCCEEECCEEEECCCCCCCCCHHHHCCCCCCEECCCEEECCHHHHHHHHHHHEEC
GGHFFMEPQIELLTRIAIEDLEPVVQRLAADGERQLAVMS
CCEEEECCHHHHHHHHHHHHHHHHHHHHHCCCCCEEEECC
>Mature Secondary Structure
MNGPIHRATPIAIIGMACRFPNADTPKAFWENIVAGRESVRELSDVELAGAGVEPEEWEA
CCCCCCCCCCEEEEEEEECCCCCCCHHHHHHHHHHHHHHHHHHHCCCEECCCCCCCCCCC
DDYIRRGAPLTGLGYFDADFFSITPREAALLDPQHRLFLENIWHAIEDAGYAVRSTEMTT
HHHHHCCCCCCCCCCCCCCCEEECCCHHHHCCHHHHHHHHHHHHHHHHCCCEEEECCCEE
GIYAGSGPSSYFARCVAGLHDFRKEGMLDSMSGFQAMLGNDKDYLATRAAHRLNLIGPAI
EEEECCCCHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHCCCHHHHHHHHHHHHHEECCCC
NVQTACSTSLVSLHLACSGLQNGECDLALAGGVTAIVPDGAGYRYQEGMILSRDGHCRPF
CCHHHHHHHHHHHHHHHCCCCCCCCCEEEECCEEEEEECCCCCEECCCEEECCCCCCCCC
DADASGTVFSSGVGVLALRRLDDALADGDTIHAVIRGSAINNDGNDKISFSAPSIEGQSS
CCCCCCCEECCCHHHHHHHHHHHHHCCCCEEEEEEECCEECCCCCCEEEEECCCCCCHHH
VVARALMNSSIAPETISYMETHGTGTKLGDPIEIEALREVFAGFPADVAPITLGSVKANI
HHHHHHHCCCCCCHHHHHHHHCCCCCCCCCCCHHHHHHHHHCCCCCCCCCEEECCEECCC
GHTIAASGVAGVIKTVMALKSRTLPPAVNFKTPNPEIDFDRLPFAVPASAVPWKSEGPRR
CCHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC
AGISSFGVGGTNAHVILEEAPGQTNGSSQPDDTPHPPDVPRTLNISARTPQALATVAKSF
CCCCCCCCCCCCEEEEEECCCCCCCCCCCCCCCCCCCCCCCEEEECCCCHHHHHHHHHHH
ALRLDMAQPDERDTICFTANTARRAFEYRRFATGRTTRELAESLRASDHARVDVSKHVVP
HEEECCCCCCCCCEEEEECCHHHHHHHHHHHHCCCHHHHHHHHHHCCCCCEEEHHHHHHH
AALFTGQGGQGEAMGRGLYESDPIFRKVFDACDAVVAPLRKHGLGDILYGDGTLAHFVHD
HHEEECCCCCCHHHCCCCCCCCHHHHHHHHHHHHHHHHHHHCCCCCEEECCCCEEEEEEC
TEYTQPALFAIELALARVLEARGFVPEIVMGHSIGEYVAAHLAGVFSLEDGLKLITKRGE
CCCCCHHHHHHHHHHHHHHHHCCCCHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHH
LMGRLPRNGGMVVLTADPDTATQMIRDSEVELAIAAENGPTSTVVAGETDALETLIKVAK
HHHCCCCCCCEEEEECCCCHHHHHHCCCCEEEEEEECCCCCCEEEECCHHHHHHHHHHHH
EKGVRTAQLKVSHAFHSHLMDPILEQFEAFASTLDFSKPDGRLISAKTGKVAGEEVADAR
HCCCEEEEEEHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCEEEECCCCCCCCHHHHHHH
YWTDHVRQPVLFHQGMMTAQEIGANLFLEIGPHPVLTPMAQAALDGIASQSQFVSSLNRT
HHHHHHCCCHHHHHCCHHHHHCCCEEEEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHC
RNDEEVLAETAGRLFLAGLTINTLIDLPDNERRLVDLPLYPFERQHHWIETRASDRLAWH
CCHHHHHHHHCCCEEEEEEEEEEEEECCCCCCEEEECCCCCCCCCCHHHHHCCCCHHHHH
CRREWHAEKQSAPQPPKDKALWIILGNALGLAGRLAQAIEKREGPEQTAVVLSNVDTGLT
HHHHHHHHHHCCCCCCCCCEEEEEECCHHHHHHHHHHHHHHCCCCCHHEEEEECCCCCCC
GGVLDAHVAGIIVTPESAEGASSGQIGEAAHSHAATLMQFVQTVQAATKNGNLAKAKIWV
CCHHHHCEEEEEECCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHCCCCEEEEEEEE
VGQSGRAVPQTDTPIPYAARPASLVSASLHGMAMVLASEHPDLWGGDIDLGAEPSDAEIA
EECCCCCCCCCCCCCCCCCCCHHHHHHHHHHEEEEEECCCCCCCCCCCCCCCCCCCCEEE
VAIGILVGGSGSETAYAVRGEERYVLRLSESGDVGTDCPVDPQKIYLVTGGLGALGSLMV
EEEEEEECCCCCCCEEEEECCCEEEEEEECCCCCCCCCCCCCCEEEEEECCHHHHHHHHH
EWLINRGARRLVLLNRDVADGAKQERLEALRRLGAEIAAHAVDIADQVGVERILGDLSEA
HHHHHCCCCEEEEEECCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
GHQLGGIIHTAGVVQDATLGSIKEASELEHALRAKLQGTLILDKASRRFSPDFFVCFSSV
HHHHCCHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHCCEEEEECCCCCCCCHHHHHHHHH
SALLGMKGQAAYVAANAAMNRIVEGRNAEGLPGVSIEWGPWAETGMASGLDERLRKRLTD
HHHHCCCCCCEEEEHHHHHHHHHCCCCCCCCCCCEECCCCCCHHHHHCCHHHHHHHHHHH
FGLLAIRNREALERLESLCASTGTLTAAPILWRRFCKKQYGQTPAWLTPLSNVQKNPQAA
CCEEEECCHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHCCCCCCCCCHHHHCCCCCCC
NDDEATDPLARLFGPVAPSDRSQAIESFLRGEVARVLGIADPDCLPMDEALNQMGFDSLA
CCCCCCCHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHCCCCCCCCCHHHHHHHCCCCCEE
TIEFRNELAKTGIKVSLQKLVMGASIAEIAADTETQVTAAVGGDADGEAVPTAPFLADSA
HHHHHHHHHHCCHHHHHHHHHHCCHHHHHHCCCCCEEEEEECCCCCCCCCCCCCCCCCCC
QGYDKSAVIIPRPKPDAPIRLIGFPYAGGGPLVFQRWIDRMPDHIEFGILQMPGRSARLE
CCCCCCEEEEECCCCCCCEEEEECCCCCCCHHHHHHHHHHCCCCEEECEEECCCCCCCCC
EGFWMRMEDMVDGIVPEMLPFLKEKPFAFLGFCYGGVQAFEIAQRVRRDHGLEPEHFFVA
CCHHEEHHHHHHHHHHHHHHHHHCCCCEEEHHHHHHHHHHHHHHHHHHHCCCCCCEEEEE
GGRSPQIYNNDQFAIDVQQFNHETGKSEHELDESAFVEMLKEVNFANNKALFEDPELRAM
CCCCCCEECCCEEEEEHHHHCCCCCCCHHHCCHHHHHHHHHHCCCCCCCCCCCCCCHHHH
MLPIIRADYEINNAYRYGFHPPLDAPITAIGGRIDPYVTGDHIIGWKEHTTKQFKAHFCA
HHHHHHCCEEECCEEEECCCCCCCCCHHHHCCCCCCEECCCEEECCHHHHHHHHHHHEEC
GGHFFMEPQIELLTRIAIEDLEPVVQRLAADGERQLAVMS
CCEEEECCHHHHHHHHHHHHHHHHHHHHHCCCCCEEEECC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 2234082; 2024119; 1740151 [H]