Definition Mycobacterium sp. MCS chromosome, complete genome.
Accession NC_008146
Length 5,705,448

Click here to switch to the map view.

The map label for this gene is dhbF [H]

Identifier: 108800432

GI number: 108800432

Start: 3679164

End: 3684401

Strand: Reverse

Name: dhbF [H]

Synonym: Mmcs_3466

Alternate gene names: 108800432

Gene position: 3684401-3679164 (Counterclockwise)

Preceding gene: 108800433

Following gene: 108800431

Centisome position: 64.58

GC content: 71.08

Gene sequence:

>5238_bases
GTGACTGACACCACCGAGCTGACTGGTGTGGATGACACCGCCCGACTGGAACTGCTGCGCCGCAGGCTCACCGAGCGCGG
GTTGTCGTCGCAGCACCCCAGAGGAACCGAACCCTCGACCCGTGAACTGTCCGAGGGGCAGCAGCGGATGTGGTTCGTCC
AGGCCGCCGACCCGTCCGGCGCGCTGCTGAACGTCTGCGTGTCCTACCGCATCCGCGGCGCCGTCGACCTCGCCGCGTTG
CGCGGCGCCCTCGACGCCGTCGCGCGCAGACATCCCGTCCTGCGAACCACCTACGCCGCCGACGACACCGGCGCACCGCG
CCCGACCGTGCACGCCGACCTGCGTCCCGCCTGGGCCGAACACGACCTGACCGGTCTGGCCAACCAGTCCGAGCAGGCGC
AGCGGCTCCGCCTCGAGGTCCTCGCCCAGCGTGAGTTCGCCGCGCCGTTCGACCTGTCCACCGACGCACCGTTGCGGATC
ACCATGGTGCACACCGGGAGCGACGAGTACGTCATGCTGCTGGTCGCCCACCACATCGCCTGGGACGACGGCTCGTGGGA
GGTCTTCTTCGGCGATCTCACCCGTGCCTACGCCGGCGAGGACCTGGGGGAGGAGCTGGAGCCCCACGCGCCTGCGGTTC
CCCGCGACGCGGCGGACGACCTCGCCTACTGGCGGCGGGTGATGGCCGATCCGCCCGAGCCACTGGAACTTCCCGGCCCG
ACCGGCTCGGCGGTGCCGACCGGTTGGCGGTCCGCGCGGACCGGTGTCGCGCTCGACGCCGACACCGCCCGGCGGGTCGT
CGACCTGGCCCGCGAGACCGGATGCACGCCGTATGCGGTGCTGCTCGCGGTGTTCGGCACCTTGATCCACCGCTACACCC
ACGCCGACGACTTCCTCGTCGCCACCCCGGTGCTCAACCGCGGTACCGGCACGGAGGACCGGATCGGCTACTACGGCAAC
ACCGTCGCGATGCGGCTGCGACCGACCACGTCGATGTCGTTCCGCGACATGCTGATCCAGACCCGCGACACCGCGCTCGG
CGCCTTCGCGCACCAGGGCGTCAACGTCGACCAGGTGGTCCGCGAACTCAACCCGGACCGTCGGCACGGCACCGAGCGGA
TGACAAGGGTCAGCTTCGGCTTCCGGGGGCCCGACCGGTTCGGATTCGCCCCGGCCGGCGTCCACTGCGAGCGCGCCGAC
CTGCGTAGCCACCTCACCCAGCTGCCGCTGGGTGTGATGGTCGAGTTCGATGCGGAGCCCTCGGGTGGGGGTGCCGTGGT
CGAGGTCGAGCACCTGGTGGAGATCATCGAACCCGCACTGGCCCAACAGCTTCTCGACCATTTCGTCGTACTGCTCGGCA
GCGCCCTCGACCGGCCGGACACCACGCTGGCGCGGTTGGCGCTGATGAGCGCCGCGGACGCCGCGTGGCTGCACGACGTC
GCCCGCGGCGACCACTTCGACACCCCGCCCCGCACACTGCCCGACCTGATCGCCGCCCAGGTCGCGACCACACCGGACGA
GATCGCGGTGGCCTACGAGGGCCGCCACTACACCTACCGGGAGATCAACGAACAGGCCAACCGCGTCGCGCACTGGCTGA
TCGGCCAGAGCATCGGGGCCGAGGACCGCGTGGCGGTGCTCCTCGACAAATCTCCCGAGTTGATCGTCACCGCGCTGGGC
GTGGCGAAGGCCGGTGCGGTGTACGTACCGGTCGACCCCACCTACCCGGAGGACCGGCTGGCGTTCATCCTCGGCGACTG
CGACGCGAAACTCGTCCTGCGGGAACCGGTCAGTGGACTCGACGGGACACCCGCCCACGACCCGACCGACGCCGACCGGT
TACGGCCGCTGCTGCCGGAGAACACCGCCTATCTGATCTACACCTCCGGCACCACCGGGCTGCCCAAGGGCGTTCCCGTA
TCCCACCGCCCGGTCGCGGAGTACTTCGTCTGGTTCAAGGCCGACTACCAGGTCGACGCCAAGGACCGGCTGCTGCAGGT
CGCCTCGCCGAGCTTCGACGTGTCGATCGCCGAGATCTTCGGCATGCTCGCCTGCGGCGCGAGGATCGTCATCCACCGCC
CGGGCGGGCTCAACGACATCGGCTATCTCACCGAACTGCTCCGCGACGAGCGCATCACCGCAATGCACTTCGTGCCGTCG
CTGCTCGGTCTGTTCCTGTCGCTGCCCGGGGTCAACCAGTGGCGCACCCTGCAGCGGGTGCCGATCGGCGGTGAGCCACT
GCCCGGTGAGGTGGCCGACAAATTCCACGCCACCTTCGATGCGCTGCTACACAACTTCTACGGCCCCACCGAGACGGTGA
TCAACGCCAGCCGTTACAAGGTGGAGGGCAAACAGGGCACCCGCATCGTGCCGATCGGCCGTCCCAAGATCAACACCCAG
ATGCACCTGCTCGACGATGCGCTGCAGCCGGTGCCCGTCGGCGTCATCGGCGAGATCTACATCGGCGGAACGCATGTGGC
GCACGGCTACCACCGCAGGCCGGGCCTGACCGCCGAACGCTTCGTCGCCGACCCGTTCACCCCCGGTGGCCGGCTCTACC
GGTCGGGCGATCTGGCCCGCCGCAACGCCGACGGCGACATCGAATTCGTCGGACGCGCCGACGAACAGGTCAAGATCCGC
GGATTCCGCATCGAACTCGGTGACGTGGCGGCCGCCATCTCCGTCGACCCGAGTGTCGGACAGGCCGTCGTGATGGTCAG
CGAGCTGCCGAACCTGGGCAAGAGCCTGGTCGGTTACCTGACCCCGGTGAGCGGTGAGGACCGCGACTCGGTGGCCGTCG
ACCGCATCCGTGCGCGGGTGGCCGCGGCGCTGCCCGAGTACATGGTGCCCGCGGCGTACGTCGTGCTCGACGAGGTCCCG
ATCACCACCCACGGCAAGATCGACCGCGCCGCGCTGCCCGCACCGGAGCTCACCTCGACCGCCGACTTCCGTGAACCCGG
GACCGACACCGAACGCGAGATGGCCCGGCTGTTCGGCGAACTGCTCGGCCGCAGCGCGAACATCGGCGCCGACGATTCGT
TCTTCGACCTCGGCGGGCACTCGCTGCTCGCCACCAAACTCGTTGCCGCCGTCCGCACCTCATGCGGGGTCGACATCGGC
GTCCAGGAGGTCTTCGAACTGGCCACGGTGGCGCAGCTCGCCGGGCACGTCGACGCCCTGCGCGCGGGCGGGGGCGGGCC
GGCACGACCACGGCTGATGCCGCTGCACCTCGACGGGCCCGCACCGCTGTCGTCGTCGCAGCTGCGGTCCTGGTTCGCCT
ACCGCGTCGACGGGCCCAGCGTGGTCAACAACATCCCGTTCGCCGCGCGGCTGCGGGGCCCGTGCGACGTCGACGCCCTG
GTCACCGCGATCGGTGACGTGGTCAACCGTCACGAGATCCTGCGCACCGTGTACCGCGAAATCGACGGGGTGCCGCACCA
GGTCGTGCTGCCACCGGAGCCGGTGACCGTGCGCCGCGCCCACGGCGACGGTGAGGAGTGGCTGCGCGCCGAACTCGACC
GCGAACGCGCCCACGTCTTCGACCTCGAGCAGGACCGGCCGATCCGCCCCGCCGTGCTGCGCGTGCCCGACGGTGTCGTG
CTGTCGGTGGTGATGCACCACATCGCCGGTGACCACTGGTCGGCGACGGTACTGTTCGCCGATCTGCTGACCGCCTACCG
GGCGCGCGCCGCGGGTGAAGCTCCCGCGTGGGCACCGCTTCCCCTGCAGTACGCCGACTTCGGCGCCTGGCAGACGGCGC
TTCTCGCCGACGACGCCGGCATCGCCGGACCGCAGCGCGACTACTGGACCCGACAGCTGGCGGGCCTGCCGGAGGAGACC
GGGCTGCGACCCGACTTCGCGCGGCCGCCGGTGCCCAGCGGACGGGCCGAGGCGGTCGAATTCCACATCGACGGGGCGAC
CCGCGACAAGCTCACGGCGCTGTGCCGCGAACTCGGCGTCACCGAGTTCATGCTGCTGCAGGCGGCGGTGGCCGTGGTGT
TGCACAAGGCGGGCGGCGGTCCCGACGTTCCGCTGGGCACCCCGGTGGCCGGCCGGTCCGAACCCGAACTCGACCAGCTG
GTCGGGTTCTTCATCAACATCCTGGTGCTGCGCAACGACCTTCGGGGCAACCCCACGCTACGCGAGGTGTGCCGTCGCGC
CCGCGAGATGGCGCTGGAGGCCTACGCCCACCAGGATCTGCCGTTCGACCAGGTGGTCGACGCGGTCAGCCCGGTGCGCA
CCCTGGCGCGCAACCCGCTGTTCAGCGTCGTGGTGCACGTGCGCGAACAGCTGCCCGAGGACCGGGTGATCGCCCATGGC
CCCGACGGCGACACGACCGTCACGGTGCTCGAGCCGACGTTCGACGCCGCGCACGCGGACCTGTCGCTGAACTTCTTCGC
CTCCGAAAGGGGGGTGGACGGCGGCTTCTCGAGCGGATACCGGGGCCACGTCATCTACCGCCCGGAGCTCTACAGCCGCG
AGACCGCACAGCGGTTCGTCGGCTGGCTGGGCCGTGTGGTGACGGCGTTCGCCGACCAGCCGGACCTCACGCTGCGAGAT
CTCGAAATCGGTGCGCCCGGGGAGCAGCGGCGCATCCTCGAAAAATGGGGCGGCGGAGGCGTATTCGTGCTCGACGAGAC
GCTGCGGCCGGTGCCCGTCGGGGTGGTCGGCGACGTCTACACCGCGGGCGGCCCGCTGGCCGCCGCGCACTGGGGCGAAG
CCGCGCTGACCGCGACGCGGTTCGTCGCCCACCCCTACGGTGCGGATGCCGGCGGGCGGCTGCACCGTACGGGTGATCAA
GCCCGCTGGAGCGCCGACGGCGTCCTCGAACTGGTCGGCGCGGAGGGCCTCGCCGCCGAACCGGCGGTGCGGGCGGCCGG
TCACACCGCGGAACCACCTGCGACCGACACCGAACGGGCGCTGGCCACCCTGCTCGCCGACGTGCTCGACGTCGAGGTCA
CCAGGCGACACGACGACTTCTTCAGCCTCGGCGGGGACAGCATCCTCGCCGTGCAGCTGGCCGCCCGCGCCCGCGACGCG
GGCCTGCGGCTGACCGCTCGGATGGTGTTCGAACAACCCACGTTGCAGGACCTCGCCGCCGCCGTCGACGCCGCGGCGGA
GACGCCCGGACCCGCGGGGGACACCGCCCACGCACCGATGAGCGCCTCGGGCCTGTCCGCGGACGAACTCGCGGCGCTGA
CGGCGTCGTGGAACGCGTCGCAGGAGGACACGCCGTGA

Upstream 100 bases:

>100_bases
CGACGCGTCCTCGGCCGGACGGTTCCGCTCGCCACGTTGCTGGGCGGAGTCACCGGCGCTGAACTGGTCGCCGAGCTCGA
CGAGAAAGTGGAAATCCCGC

Downstream 100 bases:

>100_bases
CGCGGACCCAGGCCGCTGCCAACGCGATCGAGGACGTGATGGCGCTGAGCCCGCTGCAGCAGGGGCTGTACTCGATGACG
ATGCTCGCGGACTCCGAGCA

Product: amino acid adenylation

Products: pyrophosphate; AMP; enterobactin; pyrophosphate; L-Seryl-AMP [C]

Alternate protein names: NA

Number of amino acids: Translated: 1745; Mature: 1744

Protein sequence:

>1745_residues
MTDTTELTGVDDTARLELLRRRLTERGLSSQHPRGTEPSTRELSEGQQRMWFVQAADPSGALLNVCVSYRIRGAVDLAAL
RGALDAVARRHPVLRTTYAADDTGAPRPTVHADLRPAWAEHDLTGLANQSEQAQRLRLEVLAQREFAAPFDLSTDAPLRI
TMVHTGSDEYVMLLVAHHIAWDDGSWEVFFGDLTRAYAGEDLGEELEPHAPAVPRDAADDLAYWRRVMADPPEPLELPGP
TGSAVPTGWRSARTGVALDADTARRVVDLARETGCTPYAVLLAVFGTLIHRYTHADDFLVATPVLNRGTGTEDRIGYYGN
TVAMRLRPTTSMSFRDMLIQTRDTALGAFAHQGVNVDQVVRELNPDRRHGTERMTRVSFGFRGPDRFGFAPAGVHCERAD
LRSHLTQLPLGVMVEFDAEPSGGGAVVEVEHLVEIIEPALAQQLLDHFVVLLGSALDRPDTTLARLALMSAADAAWLHDV
ARGDHFDTPPRTLPDLIAAQVATTPDEIAVAYEGRHYTYREINEQANRVAHWLIGQSIGAEDRVAVLLDKSPELIVTALG
VAKAGAVYVPVDPTYPEDRLAFILGDCDAKLVLREPVSGLDGTPAHDPTDADRLRPLLPENTAYLIYTSGTTGLPKGVPV
SHRPVAEYFVWFKADYQVDAKDRLLQVASPSFDVSIAEIFGMLACGARIVIHRPGGLNDIGYLTELLRDERITAMHFVPS
LLGLFLSLPGVNQWRTLQRVPIGGEPLPGEVADKFHATFDALLHNFYGPTETVINASRYKVEGKQGTRIVPIGRPKINTQ
MHLLDDALQPVPVGVIGEIYIGGTHVAHGYHRRPGLTAERFVADPFTPGGRLYRSGDLARRNADGDIEFVGRADEQVKIR
GFRIELGDVAAAISVDPSVGQAVVMVSELPNLGKSLVGYLTPVSGEDRDSVAVDRIRARVAAALPEYMVPAAYVVLDEVP
ITTHGKIDRAALPAPELTSTADFREPGTDTEREMARLFGELLGRSANIGADDSFFDLGGHSLLATKLVAAVRTSCGVDIG
VQEVFELATVAQLAGHVDALRAGGGGPARPRLMPLHLDGPAPLSSSQLRSWFAYRVDGPSVVNNIPFAARLRGPCDVDAL
VTAIGDVVNRHEILRTVYREIDGVPHQVVLPPEPVTVRRAHGDGEEWLRAELDRERAHVFDLEQDRPIRPAVLRVPDGVV
LSVVMHHIAGDHWSATVLFADLLTAYRARAAGEAPAWAPLPLQYADFGAWQTALLADDAGIAGPQRDYWTRQLAGLPEET
GLRPDFARPPVPSGRAEAVEFHIDGATRDKLTALCRELGVTEFMLLQAAVAVVLHKAGGGPDVPLGTPVAGRSEPELDQL
VGFFINILVLRNDLRGNPTLREVCRRAREMALEAYAHQDLPFDQVVDAVSPVRTLARNPLFSVVVHVREQLPEDRVIAHG
PDGDTTVTVLEPTFDAAHADLSLNFFASERGVDGGFSSGYRGHVIYRPELYSRETAQRFVGWLGRVVTAFADQPDLTLRD
LEIGAPGEQRRILEKWGGGGVFVLDETLRPVPVGVVGDVYTAGGPLAAAHWGEAALTATRFVAHPYGADAGGRLHRTGDQ
ARWSADGVLELVGAEGLAAEPAVRAAGHTAEPPATDTERALATLLADVLDVEVTRRHDDFFSLGGDSILAVQLAARARDA
GLRLTARMVFEQPTLQDLAAAVDAAAETPGPAGDTAHAPMSASGLSADELAALTASWNASQEDTP

Sequences:

>Translated_1745_residues
MTDTTELTGVDDTARLELLRRRLTERGLSSQHPRGTEPSTRELSEGQQRMWFVQAADPSGALLNVCVSYRIRGAVDLAAL
RGALDAVARRHPVLRTTYAADDTGAPRPTVHADLRPAWAEHDLTGLANQSEQAQRLRLEVLAQREFAAPFDLSTDAPLRI
TMVHTGSDEYVMLLVAHHIAWDDGSWEVFFGDLTRAYAGEDLGEELEPHAPAVPRDAADDLAYWRRVMADPPEPLELPGP
TGSAVPTGWRSARTGVALDADTARRVVDLARETGCTPYAVLLAVFGTLIHRYTHADDFLVATPVLNRGTGTEDRIGYYGN
TVAMRLRPTTSMSFRDMLIQTRDTALGAFAHQGVNVDQVVRELNPDRRHGTERMTRVSFGFRGPDRFGFAPAGVHCERAD
LRSHLTQLPLGVMVEFDAEPSGGGAVVEVEHLVEIIEPALAQQLLDHFVVLLGSALDRPDTTLARLALMSAADAAWLHDV
ARGDHFDTPPRTLPDLIAAQVATTPDEIAVAYEGRHYTYREINEQANRVAHWLIGQSIGAEDRVAVLLDKSPELIVTALG
VAKAGAVYVPVDPTYPEDRLAFILGDCDAKLVLREPVSGLDGTPAHDPTDADRLRPLLPENTAYLIYTSGTTGLPKGVPV
SHRPVAEYFVWFKADYQVDAKDRLLQVASPSFDVSIAEIFGMLACGARIVIHRPGGLNDIGYLTELLRDERITAMHFVPS
LLGLFLSLPGVNQWRTLQRVPIGGEPLPGEVADKFHATFDALLHNFYGPTETVINASRYKVEGKQGTRIVPIGRPKINTQ
MHLLDDALQPVPVGVIGEIYIGGTHVAHGYHRRPGLTAERFVADPFTPGGRLYRSGDLARRNADGDIEFVGRADEQVKIR
GFRIELGDVAAAISVDPSVGQAVVMVSELPNLGKSLVGYLTPVSGEDRDSVAVDRIRARVAAALPEYMVPAAYVVLDEVP
ITTHGKIDRAALPAPELTSTADFREPGTDTEREMARLFGELLGRSANIGADDSFFDLGGHSLLATKLVAAVRTSCGVDIG
VQEVFELATVAQLAGHVDALRAGGGGPARPRLMPLHLDGPAPLSSSQLRSWFAYRVDGPSVVNNIPFAARLRGPCDVDAL
VTAIGDVVNRHEILRTVYREIDGVPHQVVLPPEPVTVRRAHGDGEEWLRAELDRERAHVFDLEQDRPIRPAVLRVPDGVV
LSVVMHHIAGDHWSATVLFADLLTAYRARAAGEAPAWAPLPLQYADFGAWQTALLADDAGIAGPQRDYWTRQLAGLPEET
GLRPDFARPPVPSGRAEAVEFHIDGATRDKLTALCRELGVTEFMLLQAAVAVVLHKAGGGPDVPLGTPVAGRSEPELDQL
VGFFINILVLRNDLRGNPTLREVCRRAREMALEAYAHQDLPFDQVVDAVSPVRTLARNPLFSVVVHVREQLPEDRVIAHG
PDGDTTVTVLEPTFDAAHADLSLNFFASERGVDGGFSSGYRGHVIYRPELYSRETAQRFVGWLGRVVTAFADQPDLTLRD
LEIGAPGEQRRILEKWGGGGVFVLDETLRPVPVGVVGDVYTAGGPLAAAHWGEAALTATRFVAHPYGADAGGRLHRTGDQ
ARWSADGVLELVGAEGLAAEPAVRAAGHTAEPPATDTERALATLLADVLDVEVTRRHDDFFSLGGDSILAVQLAARARDA
GLRLTARMVFEQPTLQDLAAAVDAAAETPGPAGDTAHAPMSASGLSADELAALTASWNASQEDTP
>Mature_1744_residues
TDTTELTGVDDTARLELLRRRLTERGLSSQHPRGTEPSTRELSEGQQRMWFVQAADPSGALLNVCVSYRIRGAVDLAALR
GALDAVARRHPVLRTTYAADDTGAPRPTVHADLRPAWAEHDLTGLANQSEQAQRLRLEVLAQREFAAPFDLSTDAPLRIT
MVHTGSDEYVMLLVAHHIAWDDGSWEVFFGDLTRAYAGEDLGEELEPHAPAVPRDAADDLAYWRRVMADPPEPLELPGPT
GSAVPTGWRSARTGVALDADTARRVVDLARETGCTPYAVLLAVFGTLIHRYTHADDFLVATPVLNRGTGTEDRIGYYGNT
VAMRLRPTTSMSFRDMLIQTRDTALGAFAHQGVNVDQVVRELNPDRRHGTERMTRVSFGFRGPDRFGFAPAGVHCERADL
RSHLTQLPLGVMVEFDAEPSGGGAVVEVEHLVEIIEPALAQQLLDHFVVLLGSALDRPDTTLARLALMSAADAAWLHDVA
RGDHFDTPPRTLPDLIAAQVATTPDEIAVAYEGRHYTYREINEQANRVAHWLIGQSIGAEDRVAVLLDKSPELIVTALGV
AKAGAVYVPVDPTYPEDRLAFILGDCDAKLVLREPVSGLDGTPAHDPTDADRLRPLLPENTAYLIYTSGTTGLPKGVPVS
HRPVAEYFVWFKADYQVDAKDRLLQVASPSFDVSIAEIFGMLACGARIVIHRPGGLNDIGYLTELLRDERITAMHFVPSL
LGLFLSLPGVNQWRTLQRVPIGGEPLPGEVADKFHATFDALLHNFYGPTETVINASRYKVEGKQGTRIVPIGRPKINTQM
HLLDDALQPVPVGVIGEIYIGGTHVAHGYHRRPGLTAERFVADPFTPGGRLYRSGDLARRNADGDIEFVGRADEQVKIRG
FRIELGDVAAAISVDPSVGQAVVMVSELPNLGKSLVGYLTPVSGEDRDSVAVDRIRARVAAALPEYMVPAAYVVLDEVPI
TTHGKIDRAALPAPELTSTADFREPGTDTEREMARLFGELLGRSANIGADDSFFDLGGHSLLATKLVAAVRTSCGVDIGV
QEVFELATVAQLAGHVDALRAGGGGPARPRLMPLHLDGPAPLSSSQLRSWFAYRVDGPSVVNNIPFAARLRGPCDVDALV
TAIGDVVNRHEILRTVYREIDGVPHQVVLPPEPVTVRRAHGDGEEWLRAELDRERAHVFDLEQDRPIRPAVLRVPDGVVL
SVVMHHIAGDHWSATVLFADLLTAYRARAAGEAPAWAPLPLQYADFGAWQTALLADDAGIAGPQRDYWTRQLAGLPEETG
LRPDFARPPVPSGRAEAVEFHIDGATRDKLTALCRELGVTEFMLLQAAVAVVLHKAGGGPDVPLGTPVAGRSEPELDQLV
GFFINILVLRNDLRGNPTLREVCRRAREMALEAYAHQDLPFDQVVDAVSPVRTLARNPLFSVVVHVREQLPEDRVIAHGP
DGDTTVTVLEPTFDAAHADLSLNFFASERGVDGGFSSGYRGHVIYRPELYSRETAQRFVGWLGRVVTAFADQPDLTLRDL
EIGAPGEQRRILEKWGGGGVFVLDETLRPVPVGVVGDVYTAGGPLAAAHWGEAALTATRFVAHPYGADAGGRLHRTGDQA
RWSADGVLELVGAEGLAAEPAVRAAGHTAEPPATDTERALATLLADVLDVEVTRRHDDFFSLGGDSILAVQLAARARDAG
LRLTARMVFEQPTLQDLAAAVDAAAETPGPAGDTAHAPMSASGLSADELAALTASWNASQEDTP

Specific function: Specifically adenylates threonine and glycine, and loads them onto their corresponding peptidyl carrier domains [H]

COG id: COG1020

COG function: function code Q; Non-ribosomal peptide synthetase modules and related proteins

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 acyl carrier domain [H]

Homologues:

Organism=Homo sapiens, GI45580730, Length=467, Percent_Identity=24.1970021413276, Blast_Score=106, Evalue=2e-22,
Organism=Homo sapiens, GI38505220, Length=499, Percent_Identity=22.8456913827655, Blast_Score=94, Evalue=2e-18,
Organism=Homo sapiens, GI115511026, Length=508, Percent_Identity=23.2283464566929, Blast_Score=83, Evalue=2e-15,
Organism=Homo sapiens, GI157311624, Length=516, Percent_Identity=23.8372093023256, Blast_Score=83, Evalue=3e-15,
Organism=Homo sapiens, GI157311622, Length=516, Percent_Identity=23.8372093023256, Blast_Score=83, Evalue=3e-15,
Organism=Homo sapiens, GI42544132, Length=509, Percent_Identity=21.2180746561886, Blast_Score=76, Evalue=3e-13,
Organism=Homo sapiens, GI122937307, Length=360, Percent_Identity=25.2777777777778, Blast_Score=74, Evalue=1e-12,
Organism=Homo sapiens, GI40807357, Length=539, Percent_Identity=21.8923933209648, Blast_Score=73, Evalue=2e-12,
Organism=Homo sapiens, GI156151445, Length=355, Percent_Identity=22.5352112676056, Blast_Score=68, Evalue=7e-11,
Organism=Escherichia coli, GI1786801, Length=600, Percent_Identity=37.1666666666667, Blast_Score=345, Evalue=2e-95,
Organism=Escherichia coli, GI145693145, Length=542, Percent_Identity=25.6457564575646, Blast_Score=119, Evalue=1e-27,
Organism=Escherichia coli, GI1788107, Length=546, Percent_Identity=23.992673992674, Blast_Score=100, Evalue=7e-22,
Organism=Escherichia coli, GI221142682, Length=496, Percent_Identity=23.991935483871, Blast_Score=93, Evalue=2e-19,
Organism=Escherichia coli, GI1786810, Length=526, Percent_Identity=23.7642585551331, Blast_Score=92, Evalue=3e-19,
Organism=Caenorhabditis elegans, GI17556356, Length=571, Percent_Identity=26.6199649737303, Blast_Score=144, Evalue=4e-34,
Organism=Caenorhabditis elegans, GI17550940, Length=495, Percent_Identity=22.8282828282828, Blast_Score=106, Evalue=1e-22,
Organism=Caenorhabditis elegans, GI17560308, Length=523, Percent_Identity=22.9445506692161, Blast_Score=93, Evalue=2e-18,
Organism=Caenorhabditis elegans, GI71994690, Length=547, Percent_Identity=20.4753199268739, Blast_Score=78, Evalue=5e-14,
Organism=Caenorhabditis elegans, GI71994694, Length=547, Percent_Identity=20.4753199268739, Blast_Score=77, Evalue=6e-14,
Organism=Caenorhabditis elegans, GI71994703, Length=550, Percent_Identity=20.7272727272727, Blast_Score=75, Evalue=5e-13,
Organism=Saccharomyces cerevisiae, GI6319591, Length=915, Percent_Identity=25.0273224043716, Blast_Score=257, Evalue=1e-68,
Organism=Saccharomyces cerevisiae, GI6319699, Length=354, Percent_Identity=22.5988700564972, Blast_Score=70, Evalue=3e-12,
Organism=Drosophila melanogaster, GI24648676, Length=641, Percent_Identity=30.2652106084243, Blast_Score=239, Evalue=1e-62,
Organism=Drosophila melanogaster, GI24581924, Length=373, Percent_Identity=24.9329758713137, Blast_Score=77, Evalue=1e-13,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR010071
- InterPro:   IPR009081
- InterPro:   IPR020845
- InterPro:   IPR000873
- InterPro:   IPR001242
- InterPro:   IPR006163
- InterPro:   IPR020806
- InterPro:   IPR001031 [H]

Pfam domain/function: PF00501 AMP-binding; PF00668 Condensation; PF00550 PP-binding; PF00975 Thioesterase [H]

EC number: 2.7.7.- [C]

Molecular weight: Translated: 188778; Mature: 188647

Theoretical pI: Translated: 5.04; Mature: 5.04

Prosite motif: PS00012 PHOSPHOPANTETHEINE ; PS50075 ACP_DOMAIN ; PS00455 AMP_BINDING

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.5 %Cys     (Translated Protein)
1.3 %Met     (Translated Protein)
1.8 %Cys+Met (Translated Protein)
0.5 %Cys     (Mature Protein)
1.3 %Met     (Mature Protein)
1.8 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MTDTTELTGVDDTARLELLRRRLTERGLSSQHPRGTEPSTRELSEGQQRMWFVQAADPSG
CCCCCCCCCCCHHHHHHHHHHHHHHCCCCCCCCCCCCCCHHHHHCCCCEEEEEEECCCCC
ALLNVCVSYRIRGAVDLAALRGALDAVARRHPVLRTTYAADDTGAPRPTVHADLRPAWAE
HHHHHHHHHHHCCHHHHHHHHHHHHHHHHCCCCEEEEECCCCCCCCCCCEECCCCCCHHH
HDLTGLANQSEQAQRLRLEVLAQREFAAPFDLSTDAPLRITMVHTGSDEYVMLLVAHHIA
CCHHHCCCCHHHHHHHHHHHHHHHHCCCCCCCCCCCCEEEEEEEECCCCEEEEEEEHHHE
WDDGSWEVFFGDLTRAYAGEDLGEELEPHAPAVPRDAADDLAYWRRVMADPPEPLELPGP
ECCCCEEEEECCHHHHHCCCHHHHHCCCCCCCCCCCCHHHHHHHHHHHCCCCCCCCCCCC
TGSAVPTGWRSARTGVALDADTARRVVDLARETGCTPYAVLLAVFGTLIHRYTHADDFLV
CCCCCCCCCHHCCCCEEECHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHCCCCCEEE
ATPVLNRGTGTEDRIGYYGNTVAMRLRPTTSMSFRDMLIQTRDTALGAFAHQGVNVDQVV
ECCCCCCCCCCCCCCCCCCCEEEEEEECCCCCHHHHHHHHHHHHHHHHHHHCCCCHHHHH
RELNPDRRHGTERMTRVSFGFRGPDRFGFAPAGVHCERADLRSHLTQLPLGVMVEFDAEP
HHCCCCHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHCCCCEEEEECCCC
SGGGAVVEVEHLVEIIEPALAQQLLDHFVVLLGSALDRPDTTLARLALMSAADAAWLHDV
CCCCCEEEHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHH
ARGDHFDTPPRTLPDLIAAQVATTPDEIAVAYEGRHYTYREINEQANRVAHWLIGQSIGA
HCCCCCCCCCHHHHHHHHHHHCCCCCCEEEEECCCCCHHHHHHHHHHHHHHHHHHCCCCC
EDRVAVLLDKSPELIVTALGVAKAGAVYVPVDPTYPEDRLAFILGDCDAKLVLREPVSGL
CCCEEEEECCCCCEEEEEHHHHCCCEEEEECCCCCCCCCEEEEEECCCCEEEEECCCCCC
DGTPAHDPTDADRLRPLLPENTAYLIYTSGTTGLPKGVPVSHRPVAEYFVWFKADYQVDA
CCCCCCCCCCHHHHCCCCCCCCEEEEEECCCCCCCCCCCCCCCCHHHEEEEEEECCEECH
KDRLLQVASPSFDVSIAEIFGMLACGARIVIHRPGGLNDIGYLTELLRDERITAMHFVPS
HHHHHHHCCCCCCEEHHHHHHHHHCCCEEEEECCCCCCHHHHHHHHHHCCCHHHHHHHHH
LLGLFLSLPGVNQWRTLQRVPIGGEPLPGEVADKFHATFDALLHNFYGPTETVINASRYK
HHHHHHCCCCCCHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHHCCCHHHHCCCCCEE
VEGKQGTRIVPIGRPKINTQMHLLDDALQPVPVGVIGEIYIGGTHVAHGYHRRPGLTAER
EECCCCCEEEECCCCCCCCHHHHHHHCCCCCCCCEEEEEEECCEEEECCCCCCCCCCHHH
FVADPFTPGGRLYRSGDLARRNADGDIEFVGRADEQVKIRGFRIELGDVAAAISVDPSVG
HCCCCCCCCCCEEECCCHHHCCCCCCEEEEECCCCEEEEEEEEEECCCEEEEEECCCCCC
QAVVMVSELPNLGKSLVGYLTPVSGEDRDSVAVDRIRARVAAALPEYMVPAAYVVLDEVP
CEEEEHHHCCHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHHHCCEEEEEEECCC
ITTHGKIDRAALPAPELTSTADFREPGTDTEREMARLFGELLGRSANIGADDSFFDLGGH
CCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHCCCCCCCCCCCEEECCCH
SLLATKLVAAVRTSCGVDIGVQEVFELATVAQLAGHVDALRAGGGGPARPRLMPLHLDGP
HHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCEEEEEECCC
APLSSSQLRSWFAYRVDGPSVVNNIPFAARLRGPCDVDALVTAIGDVVNRHEILRTVYRE
CCCCHHHHHHHHEEECCCCHHHHCCCCCEECCCCCCHHHHHHHHHHHHHHHHHHHHHHHH
IDGVPHQVVLPPEPVTVRRAHGDGEEWLRAELDRERAHVFDLEQDRPIRPAVLRVPDGVV
HCCCCCEEEECCCCCEEEECCCCHHHHHHHHHHHHHHHEECCCCCCCCCCEEEECCCHHH
LSVVMHHIAGDHWSATVLFADLLTAYRARAAGEAPAWAPLPLQYADFGAWQTALLADDAG
HHHHHHHHCCCCHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCHHHHEEECCCC
IAGPQRDYWTRQLAGLPEETGLRPDFARPPVPSGRAEAVEFHIDGATRDKLTALCRELGV
CCCCCHHHHHHHHCCCCHHCCCCCCCCCCCCCCCCCEEEEEEECCCCHHHHHHHHHHHCH
TEFMLLQAAVAVVLHKAGGGPDVPLGTPVAGRSEPELDQLVGFFINILVLRNDLRGNPTL
HHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHCCCCCCCHH
REVCRRAREMALEAYAHQDLPFDQVVDAVSPVRTLARNPLFSVVVHVREQLPEDRVIAHG
HHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHCHHHHHHHHHHHHCCCCCEEEEC
PDGDTTVTVLEPTFDAAHADLSLNFFASERGVDGGFSSGYRGHVIYRPELYSRETAQRFV
CCCCCEEEEECCCCCCCCCCEEEEEEECCCCCCCCCCCCCCCEEEECCCHHHHHHHHHHH
GWLGRVVTAFADQPDLTLRDLEIGAPGEQRRILEKWGGGGVFVLDETLRPVPVGVVGDVY
HHHHHHHHHHCCCCCCEEEEEECCCCCHHHHHHHHCCCCCEEEECCCCCCCCCCEECCCC
TAGGPLAAAHWGEAALTATRFVAHPYGADAGGRLHRTGDQARWSADGVLELVGAEGLAAE
CCCCCEEEHHCCCHHHHHHHHHCCCCCCCCCCCEECCCCCCCCCCCCHHEEECCCCCCCC
PAVRAAGHTAEPPATDTERALATLLADVLDVEVTRRHDDFFSLGGDSILAVQLAARARDA
CHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHCCCHHHHCCCCCEEEEEHHHHHHCC
GLRLTARMVFEQPTLQDLAAAVDAAAETPGPAGDTAHAPMSASGLSADELAALTASWNAS
CCEEEEHHHHCCCCHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCHHHHHHHHCCCCCC
QEDTP
CCCCC
>Mature Secondary Structure 
TDTTELTGVDDTARLELLRRRLTERGLSSQHPRGTEPSTRELSEGQQRMWFVQAADPSG
CCCCCCCCCCHHHHHHHHHHHHHHCCCCCCCCCCCCCCHHHHHCCCCEEEEEEECCCCC
ALLNVCVSYRIRGAVDLAALRGALDAVARRHPVLRTTYAADDTGAPRPTVHADLRPAWAE
HHHHHHHHHHHCCHHHHHHHHHHHHHHHHCCCCEEEEECCCCCCCCCCCEECCCCCCHHH
HDLTGLANQSEQAQRLRLEVLAQREFAAPFDLSTDAPLRITMVHTGSDEYVMLLVAHHIA
CCHHHCCCCHHHHHHHHHHHHHHHHCCCCCCCCCCCCEEEEEEEECCCCEEEEEEEHHHE
WDDGSWEVFFGDLTRAYAGEDLGEELEPHAPAVPRDAADDLAYWRRVMADPPEPLELPGP
ECCCCEEEEECCHHHHHCCCHHHHHCCCCCCCCCCCCHHHHHHHHHHHCCCCCCCCCCCC
TGSAVPTGWRSARTGVALDADTARRVVDLARETGCTPYAVLLAVFGTLIHRYTHADDFLV
CCCCCCCCCHHCCCCEEECHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHCCCCCEEE
ATPVLNRGTGTEDRIGYYGNTVAMRLRPTTSMSFRDMLIQTRDTALGAFAHQGVNVDQVV
ECCCCCCCCCCCCCCCCCCCEEEEEEECCCCCHHHHHHHHHHHHHHHHHHHCCCCHHHHH
RELNPDRRHGTERMTRVSFGFRGPDRFGFAPAGVHCERADLRSHLTQLPLGVMVEFDAEP
HHCCCCHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHCCCCEEEEECCCC
SGGGAVVEVEHLVEIIEPALAQQLLDHFVVLLGSALDRPDTTLARLALMSAADAAWLHDV
CCCCCEEEHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHH
ARGDHFDTPPRTLPDLIAAQVATTPDEIAVAYEGRHYTYREINEQANRVAHWLIGQSIGA
HCCCCCCCCCHHHHHHHHHHHCCCCCCEEEEECCCCCHHHHHHHHHHHHHHHHHHCCCCC
EDRVAVLLDKSPELIVTALGVAKAGAVYVPVDPTYPEDRLAFILGDCDAKLVLREPVSGL
CCCEEEEECCCCCEEEEEHHHHCCCEEEEECCCCCCCCCEEEEEECCCCEEEEECCCCCC
DGTPAHDPTDADRLRPLLPENTAYLIYTSGTTGLPKGVPVSHRPVAEYFVWFKADYQVDA
CCCCCCCCCCHHHHCCCCCCCCEEEEEECCCCCCCCCCCCCCCCHHHEEEEEEECCEECH
KDRLLQVASPSFDVSIAEIFGMLACGARIVIHRPGGLNDIGYLTELLRDERITAMHFVPS
HHHHHHHCCCCCCEEHHHHHHHHHCCCEEEEECCCCCCHHHHHHHHHHCCCHHHHHHHHH
LLGLFLSLPGVNQWRTLQRVPIGGEPLPGEVADKFHATFDALLHNFYGPTETVINASRYK
HHHHHHCCCCCCHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHHCCCHHHHCCCCCEE
VEGKQGTRIVPIGRPKINTQMHLLDDALQPVPVGVIGEIYIGGTHVAHGYHRRPGLTAER
EECCCCCEEEECCCCCCCCHHHHHHHCCCCCCCCEEEEEEECCEEEECCCCCCCCCCHHH
FVADPFTPGGRLYRSGDLARRNADGDIEFVGRADEQVKIRGFRIELGDVAAAISVDPSVG
HCCCCCCCCCCEEECCCHHHCCCCCCEEEEECCCCEEEEEEEEEECCCEEEEEECCCCCC
QAVVMVSELPNLGKSLVGYLTPVSGEDRDSVAVDRIRARVAAALPEYMVPAAYVVLDEVP
CEEEEHHHCCHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHHHCCEEEEEEECCC
ITTHGKIDRAALPAPELTSTADFREPGTDTEREMARLFGELLGRSANIGADDSFFDLGGH
CCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHCCCCCCCCCCCEEECCCH
SLLATKLVAAVRTSCGVDIGVQEVFELATVAQLAGHVDALRAGGGGPARPRLMPLHLDGP
HHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCEEEEEECCC
APLSSSQLRSWFAYRVDGPSVVNNIPFAARLRGPCDVDALVTAIGDVVNRHEILRTVYRE
CCCCHHHHHHHHEEECCCCHHHHCCCCCEECCCCCCHHHHHHHHHHHHHHHHHHHHHHHH
IDGVPHQVVLPPEPVTVRRAHGDGEEWLRAELDRERAHVFDLEQDRPIRPAVLRVPDGVV
HCCCCCEEEECCCCCEEEECCCCHHHHHHHHHHHHHHHEECCCCCCCCCCEEEECCCHHH
LSVVMHHIAGDHWSATVLFADLLTAYRARAAGEAPAWAPLPLQYADFGAWQTALLADDAG
HHHHHHHHCCCCHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCHHHHEEECCCC
IAGPQRDYWTRQLAGLPEETGLRPDFARPPVPSGRAEAVEFHIDGATRDKLTALCRELGV
CCCCCHHHHHHHHCCCCHHCCCCCCCCCCCCCCCCCEEEEEEECCCCHHHHHHHHHHHCH
TEFMLLQAAVAVVLHKAGGGPDVPLGTPVAGRSEPELDQLVGFFINILVLRNDLRGNPTL
HHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHCCCCCCCHH
REVCRRAREMALEAYAHQDLPFDQVVDAVSPVRTLARNPLFSVVVHVREQLPEDRVIAHG
HHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHCHHHHHHHHHHHHCCCCCEEEEC
PDGDTTVTVLEPTFDAAHADLSLNFFASERGVDGGFSSGYRGHVIYRPELYSRETAQRFV
CCCCCEEEEECCCCCCCCCCEEEEEEECCCCCCCCCCCCCCCEEEECCCHHHHHHHHHHH
GWLGRVVTAFADQPDLTLRDLEIGAPGEQRRILEKWGGGGVFVLDETLRPVPVGVVGDVY
HHHHHHHHHHCCCCCCEEEEEECCCCCHHHHHHHHCCCCCEEEECCCCCCCCCCEECCCC
TAGGPLAAAHWGEAALTATRFVAHPYGADAGGRLHRTGDQARWSADGVLELVGAEGLAAE
CCCCCEEEHHCCCHHHHHHHHHCCCCCCCCCCCEECCCCCCCCCCCCHHEEECCCCCCCC
PAVRAAGHTAEPPATDTERALATLLADVLDVEVTRRHDDFFSLGGDSILAVQLAARARDA
CHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHCCCHHHHCCCCCEEEEEHHHHHHCC
GLRLTARMVFEQPTLQDLAAAVDAAAETPGPAGDTAHAPMSASGLSADELAALTASWNAS
CCEEEEHHHHCCCCHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCHHHHHHHHCCCCCC
QEDTP
CCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: Phosphopantetheine. [C]

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: 6 ATP; L-serine; 2,3-dihydroxybenzoate [C]

Specific reaction: 6 ATP + 3 L-serine + 3 2,3-dihydroxybenzoate = 6 pyrophosphate + 6 AMP + enterobactin ATP + L-serine = pyrophosphate + L-Seryl-AMP 6 ATP + 3 L-serine + 3 2,3-dihydroxybenzoate = 6 pyrophosphate + 6 AMP + enterobactin ATP + L-serine = pyrophosphate + L-Ser

General reaction: Transferases; Acyltransferases; Transferring groups other than amino-acyl groups [C]

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 11112781; 9384377; 10568751; 8550523 [H]