| Definition | Mycobacterium sp. MCS chromosome, complete genome. |
|---|---|
| Accession | NC_008146 |
| Length | 5,705,448 |
Click here to switch to the map view.
The map label for this gene is dhbF [H]
Identifier: 108800432
GI number: 108800432
Start: 3679164
End: 3684401
Strand: Reverse
Name: dhbF [H]
Synonym: Mmcs_3466
Alternate gene names: 108800432
Gene position: 3684401-3679164 (Counterclockwise)
Preceding gene: 108800433
Following gene: 108800431
Centisome position: 64.58
GC content: 71.08
Gene sequence:
>5238_bases GTGACTGACACCACCGAGCTGACTGGTGTGGATGACACCGCCCGACTGGAACTGCTGCGCCGCAGGCTCACCGAGCGCGG GTTGTCGTCGCAGCACCCCAGAGGAACCGAACCCTCGACCCGTGAACTGTCCGAGGGGCAGCAGCGGATGTGGTTCGTCC AGGCCGCCGACCCGTCCGGCGCGCTGCTGAACGTCTGCGTGTCCTACCGCATCCGCGGCGCCGTCGACCTCGCCGCGTTG CGCGGCGCCCTCGACGCCGTCGCGCGCAGACATCCCGTCCTGCGAACCACCTACGCCGCCGACGACACCGGCGCACCGCG CCCGACCGTGCACGCCGACCTGCGTCCCGCCTGGGCCGAACACGACCTGACCGGTCTGGCCAACCAGTCCGAGCAGGCGC AGCGGCTCCGCCTCGAGGTCCTCGCCCAGCGTGAGTTCGCCGCGCCGTTCGACCTGTCCACCGACGCACCGTTGCGGATC ACCATGGTGCACACCGGGAGCGACGAGTACGTCATGCTGCTGGTCGCCCACCACATCGCCTGGGACGACGGCTCGTGGGA GGTCTTCTTCGGCGATCTCACCCGTGCCTACGCCGGCGAGGACCTGGGGGAGGAGCTGGAGCCCCACGCGCCTGCGGTTC CCCGCGACGCGGCGGACGACCTCGCCTACTGGCGGCGGGTGATGGCCGATCCGCCCGAGCCACTGGAACTTCCCGGCCCG ACCGGCTCGGCGGTGCCGACCGGTTGGCGGTCCGCGCGGACCGGTGTCGCGCTCGACGCCGACACCGCCCGGCGGGTCGT CGACCTGGCCCGCGAGACCGGATGCACGCCGTATGCGGTGCTGCTCGCGGTGTTCGGCACCTTGATCCACCGCTACACCC ACGCCGACGACTTCCTCGTCGCCACCCCGGTGCTCAACCGCGGTACCGGCACGGAGGACCGGATCGGCTACTACGGCAAC ACCGTCGCGATGCGGCTGCGACCGACCACGTCGATGTCGTTCCGCGACATGCTGATCCAGACCCGCGACACCGCGCTCGG CGCCTTCGCGCACCAGGGCGTCAACGTCGACCAGGTGGTCCGCGAACTCAACCCGGACCGTCGGCACGGCACCGAGCGGA TGACAAGGGTCAGCTTCGGCTTCCGGGGGCCCGACCGGTTCGGATTCGCCCCGGCCGGCGTCCACTGCGAGCGCGCCGAC CTGCGTAGCCACCTCACCCAGCTGCCGCTGGGTGTGATGGTCGAGTTCGATGCGGAGCCCTCGGGTGGGGGTGCCGTGGT CGAGGTCGAGCACCTGGTGGAGATCATCGAACCCGCACTGGCCCAACAGCTTCTCGACCATTTCGTCGTACTGCTCGGCA GCGCCCTCGACCGGCCGGACACCACGCTGGCGCGGTTGGCGCTGATGAGCGCCGCGGACGCCGCGTGGCTGCACGACGTC GCCCGCGGCGACCACTTCGACACCCCGCCCCGCACACTGCCCGACCTGATCGCCGCCCAGGTCGCGACCACACCGGACGA GATCGCGGTGGCCTACGAGGGCCGCCACTACACCTACCGGGAGATCAACGAACAGGCCAACCGCGTCGCGCACTGGCTGA TCGGCCAGAGCATCGGGGCCGAGGACCGCGTGGCGGTGCTCCTCGACAAATCTCCCGAGTTGATCGTCACCGCGCTGGGC GTGGCGAAGGCCGGTGCGGTGTACGTACCGGTCGACCCCACCTACCCGGAGGACCGGCTGGCGTTCATCCTCGGCGACTG CGACGCGAAACTCGTCCTGCGGGAACCGGTCAGTGGACTCGACGGGACACCCGCCCACGACCCGACCGACGCCGACCGGT TACGGCCGCTGCTGCCGGAGAACACCGCCTATCTGATCTACACCTCCGGCACCACCGGGCTGCCCAAGGGCGTTCCCGTA TCCCACCGCCCGGTCGCGGAGTACTTCGTCTGGTTCAAGGCCGACTACCAGGTCGACGCCAAGGACCGGCTGCTGCAGGT CGCCTCGCCGAGCTTCGACGTGTCGATCGCCGAGATCTTCGGCATGCTCGCCTGCGGCGCGAGGATCGTCATCCACCGCC CGGGCGGGCTCAACGACATCGGCTATCTCACCGAACTGCTCCGCGACGAGCGCATCACCGCAATGCACTTCGTGCCGTCG CTGCTCGGTCTGTTCCTGTCGCTGCCCGGGGTCAACCAGTGGCGCACCCTGCAGCGGGTGCCGATCGGCGGTGAGCCACT GCCCGGTGAGGTGGCCGACAAATTCCACGCCACCTTCGATGCGCTGCTACACAACTTCTACGGCCCCACCGAGACGGTGA TCAACGCCAGCCGTTACAAGGTGGAGGGCAAACAGGGCACCCGCATCGTGCCGATCGGCCGTCCCAAGATCAACACCCAG ATGCACCTGCTCGACGATGCGCTGCAGCCGGTGCCCGTCGGCGTCATCGGCGAGATCTACATCGGCGGAACGCATGTGGC GCACGGCTACCACCGCAGGCCGGGCCTGACCGCCGAACGCTTCGTCGCCGACCCGTTCACCCCCGGTGGCCGGCTCTACC GGTCGGGCGATCTGGCCCGCCGCAACGCCGACGGCGACATCGAATTCGTCGGACGCGCCGACGAACAGGTCAAGATCCGC GGATTCCGCATCGAACTCGGTGACGTGGCGGCCGCCATCTCCGTCGACCCGAGTGTCGGACAGGCCGTCGTGATGGTCAG CGAGCTGCCGAACCTGGGCAAGAGCCTGGTCGGTTACCTGACCCCGGTGAGCGGTGAGGACCGCGACTCGGTGGCCGTCG ACCGCATCCGTGCGCGGGTGGCCGCGGCGCTGCCCGAGTACATGGTGCCCGCGGCGTACGTCGTGCTCGACGAGGTCCCG ATCACCACCCACGGCAAGATCGACCGCGCCGCGCTGCCCGCACCGGAGCTCACCTCGACCGCCGACTTCCGTGAACCCGG GACCGACACCGAACGCGAGATGGCCCGGCTGTTCGGCGAACTGCTCGGCCGCAGCGCGAACATCGGCGCCGACGATTCGT TCTTCGACCTCGGCGGGCACTCGCTGCTCGCCACCAAACTCGTTGCCGCCGTCCGCACCTCATGCGGGGTCGACATCGGC GTCCAGGAGGTCTTCGAACTGGCCACGGTGGCGCAGCTCGCCGGGCACGTCGACGCCCTGCGCGCGGGCGGGGGCGGGCC GGCACGACCACGGCTGATGCCGCTGCACCTCGACGGGCCCGCACCGCTGTCGTCGTCGCAGCTGCGGTCCTGGTTCGCCT ACCGCGTCGACGGGCCCAGCGTGGTCAACAACATCCCGTTCGCCGCGCGGCTGCGGGGCCCGTGCGACGTCGACGCCCTG GTCACCGCGATCGGTGACGTGGTCAACCGTCACGAGATCCTGCGCACCGTGTACCGCGAAATCGACGGGGTGCCGCACCA GGTCGTGCTGCCACCGGAGCCGGTGACCGTGCGCCGCGCCCACGGCGACGGTGAGGAGTGGCTGCGCGCCGAACTCGACC GCGAACGCGCCCACGTCTTCGACCTCGAGCAGGACCGGCCGATCCGCCCCGCCGTGCTGCGCGTGCCCGACGGTGTCGTG CTGTCGGTGGTGATGCACCACATCGCCGGTGACCACTGGTCGGCGACGGTACTGTTCGCCGATCTGCTGACCGCCTACCG GGCGCGCGCCGCGGGTGAAGCTCCCGCGTGGGCACCGCTTCCCCTGCAGTACGCCGACTTCGGCGCCTGGCAGACGGCGC TTCTCGCCGACGACGCCGGCATCGCCGGACCGCAGCGCGACTACTGGACCCGACAGCTGGCGGGCCTGCCGGAGGAGACC GGGCTGCGACCCGACTTCGCGCGGCCGCCGGTGCCCAGCGGACGGGCCGAGGCGGTCGAATTCCACATCGACGGGGCGAC CCGCGACAAGCTCACGGCGCTGTGCCGCGAACTCGGCGTCACCGAGTTCATGCTGCTGCAGGCGGCGGTGGCCGTGGTGT TGCACAAGGCGGGCGGCGGTCCCGACGTTCCGCTGGGCACCCCGGTGGCCGGCCGGTCCGAACCCGAACTCGACCAGCTG GTCGGGTTCTTCATCAACATCCTGGTGCTGCGCAACGACCTTCGGGGCAACCCCACGCTACGCGAGGTGTGCCGTCGCGC CCGCGAGATGGCGCTGGAGGCCTACGCCCACCAGGATCTGCCGTTCGACCAGGTGGTCGACGCGGTCAGCCCGGTGCGCA CCCTGGCGCGCAACCCGCTGTTCAGCGTCGTGGTGCACGTGCGCGAACAGCTGCCCGAGGACCGGGTGATCGCCCATGGC CCCGACGGCGACACGACCGTCACGGTGCTCGAGCCGACGTTCGACGCCGCGCACGCGGACCTGTCGCTGAACTTCTTCGC CTCCGAAAGGGGGGTGGACGGCGGCTTCTCGAGCGGATACCGGGGCCACGTCATCTACCGCCCGGAGCTCTACAGCCGCG AGACCGCACAGCGGTTCGTCGGCTGGCTGGGCCGTGTGGTGACGGCGTTCGCCGACCAGCCGGACCTCACGCTGCGAGAT CTCGAAATCGGTGCGCCCGGGGAGCAGCGGCGCATCCTCGAAAAATGGGGCGGCGGAGGCGTATTCGTGCTCGACGAGAC GCTGCGGCCGGTGCCCGTCGGGGTGGTCGGCGACGTCTACACCGCGGGCGGCCCGCTGGCCGCCGCGCACTGGGGCGAAG CCGCGCTGACCGCGACGCGGTTCGTCGCCCACCCCTACGGTGCGGATGCCGGCGGGCGGCTGCACCGTACGGGTGATCAA GCCCGCTGGAGCGCCGACGGCGTCCTCGAACTGGTCGGCGCGGAGGGCCTCGCCGCCGAACCGGCGGTGCGGGCGGCCGG TCACACCGCGGAACCACCTGCGACCGACACCGAACGGGCGCTGGCCACCCTGCTCGCCGACGTGCTCGACGTCGAGGTCA CCAGGCGACACGACGACTTCTTCAGCCTCGGCGGGGACAGCATCCTCGCCGTGCAGCTGGCCGCCCGCGCCCGCGACGCG GGCCTGCGGCTGACCGCTCGGATGGTGTTCGAACAACCCACGTTGCAGGACCTCGCCGCCGCCGTCGACGCCGCGGCGGA GACGCCCGGACCCGCGGGGGACACCGCCCACGCACCGATGAGCGCCTCGGGCCTGTCCGCGGACGAACTCGCGGCGCTGA CGGCGTCGTGGAACGCGTCGCAGGAGGACACGCCGTGA
Upstream 100 bases:
>100_bases CGACGCGTCCTCGGCCGGACGGTTCCGCTCGCCACGTTGCTGGGCGGAGTCACCGGCGCTGAACTGGTCGCCGAGCTCGA CGAGAAAGTGGAAATCCCGC
Downstream 100 bases:
>100_bases CGCGGACCCAGGCCGCTGCCAACGCGATCGAGGACGTGATGGCGCTGAGCCCGCTGCAGCAGGGGCTGTACTCGATGACG ATGCTCGCGGACTCCGAGCA
Product: amino acid adenylation
Products: pyrophosphate; AMP; enterobactin; pyrophosphate; L-Seryl-AMP [C]
Alternate protein names: NA
Number of amino acids: Translated: 1745; Mature: 1744
Protein sequence:
>1745_residues MTDTTELTGVDDTARLELLRRRLTERGLSSQHPRGTEPSTRELSEGQQRMWFVQAADPSGALLNVCVSYRIRGAVDLAAL RGALDAVARRHPVLRTTYAADDTGAPRPTVHADLRPAWAEHDLTGLANQSEQAQRLRLEVLAQREFAAPFDLSTDAPLRI TMVHTGSDEYVMLLVAHHIAWDDGSWEVFFGDLTRAYAGEDLGEELEPHAPAVPRDAADDLAYWRRVMADPPEPLELPGP TGSAVPTGWRSARTGVALDADTARRVVDLARETGCTPYAVLLAVFGTLIHRYTHADDFLVATPVLNRGTGTEDRIGYYGN TVAMRLRPTTSMSFRDMLIQTRDTALGAFAHQGVNVDQVVRELNPDRRHGTERMTRVSFGFRGPDRFGFAPAGVHCERAD LRSHLTQLPLGVMVEFDAEPSGGGAVVEVEHLVEIIEPALAQQLLDHFVVLLGSALDRPDTTLARLALMSAADAAWLHDV ARGDHFDTPPRTLPDLIAAQVATTPDEIAVAYEGRHYTYREINEQANRVAHWLIGQSIGAEDRVAVLLDKSPELIVTALG VAKAGAVYVPVDPTYPEDRLAFILGDCDAKLVLREPVSGLDGTPAHDPTDADRLRPLLPENTAYLIYTSGTTGLPKGVPV SHRPVAEYFVWFKADYQVDAKDRLLQVASPSFDVSIAEIFGMLACGARIVIHRPGGLNDIGYLTELLRDERITAMHFVPS LLGLFLSLPGVNQWRTLQRVPIGGEPLPGEVADKFHATFDALLHNFYGPTETVINASRYKVEGKQGTRIVPIGRPKINTQ MHLLDDALQPVPVGVIGEIYIGGTHVAHGYHRRPGLTAERFVADPFTPGGRLYRSGDLARRNADGDIEFVGRADEQVKIR GFRIELGDVAAAISVDPSVGQAVVMVSELPNLGKSLVGYLTPVSGEDRDSVAVDRIRARVAAALPEYMVPAAYVVLDEVP ITTHGKIDRAALPAPELTSTADFREPGTDTEREMARLFGELLGRSANIGADDSFFDLGGHSLLATKLVAAVRTSCGVDIG VQEVFELATVAQLAGHVDALRAGGGGPARPRLMPLHLDGPAPLSSSQLRSWFAYRVDGPSVVNNIPFAARLRGPCDVDAL VTAIGDVVNRHEILRTVYREIDGVPHQVVLPPEPVTVRRAHGDGEEWLRAELDRERAHVFDLEQDRPIRPAVLRVPDGVV LSVVMHHIAGDHWSATVLFADLLTAYRARAAGEAPAWAPLPLQYADFGAWQTALLADDAGIAGPQRDYWTRQLAGLPEET GLRPDFARPPVPSGRAEAVEFHIDGATRDKLTALCRELGVTEFMLLQAAVAVVLHKAGGGPDVPLGTPVAGRSEPELDQL VGFFINILVLRNDLRGNPTLREVCRRAREMALEAYAHQDLPFDQVVDAVSPVRTLARNPLFSVVVHVREQLPEDRVIAHG PDGDTTVTVLEPTFDAAHADLSLNFFASERGVDGGFSSGYRGHVIYRPELYSRETAQRFVGWLGRVVTAFADQPDLTLRD LEIGAPGEQRRILEKWGGGGVFVLDETLRPVPVGVVGDVYTAGGPLAAAHWGEAALTATRFVAHPYGADAGGRLHRTGDQ ARWSADGVLELVGAEGLAAEPAVRAAGHTAEPPATDTERALATLLADVLDVEVTRRHDDFFSLGGDSILAVQLAARARDA GLRLTARMVFEQPTLQDLAAAVDAAAETPGPAGDTAHAPMSASGLSADELAALTASWNASQEDTP
Sequences:
>Translated_1745_residues MTDTTELTGVDDTARLELLRRRLTERGLSSQHPRGTEPSTRELSEGQQRMWFVQAADPSGALLNVCVSYRIRGAVDLAAL RGALDAVARRHPVLRTTYAADDTGAPRPTVHADLRPAWAEHDLTGLANQSEQAQRLRLEVLAQREFAAPFDLSTDAPLRI TMVHTGSDEYVMLLVAHHIAWDDGSWEVFFGDLTRAYAGEDLGEELEPHAPAVPRDAADDLAYWRRVMADPPEPLELPGP TGSAVPTGWRSARTGVALDADTARRVVDLARETGCTPYAVLLAVFGTLIHRYTHADDFLVATPVLNRGTGTEDRIGYYGN TVAMRLRPTTSMSFRDMLIQTRDTALGAFAHQGVNVDQVVRELNPDRRHGTERMTRVSFGFRGPDRFGFAPAGVHCERAD LRSHLTQLPLGVMVEFDAEPSGGGAVVEVEHLVEIIEPALAQQLLDHFVVLLGSALDRPDTTLARLALMSAADAAWLHDV ARGDHFDTPPRTLPDLIAAQVATTPDEIAVAYEGRHYTYREINEQANRVAHWLIGQSIGAEDRVAVLLDKSPELIVTALG VAKAGAVYVPVDPTYPEDRLAFILGDCDAKLVLREPVSGLDGTPAHDPTDADRLRPLLPENTAYLIYTSGTTGLPKGVPV SHRPVAEYFVWFKADYQVDAKDRLLQVASPSFDVSIAEIFGMLACGARIVIHRPGGLNDIGYLTELLRDERITAMHFVPS LLGLFLSLPGVNQWRTLQRVPIGGEPLPGEVADKFHATFDALLHNFYGPTETVINASRYKVEGKQGTRIVPIGRPKINTQ MHLLDDALQPVPVGVIGEIYIGGTHVAHGYHRRPGLTAERFVADPFTPGGRLYRSGDLARRNADGDIEFVGRADEQVKIR GFRIELGDVAAAISVDPSVGQAVVMVSELPNLGKSLVGYLTPVSGEDRDSVAVDRIRARVAAALPEYMVPAAYVVLDEVP ITTHGKIDRAALPAPELTSTADFREPGTDTEREMARLFGELLGRSANIGADDSFFDLGGHSLLATKLVAAVRTSCGVDIG VQEVFELATVAQLAGHVDALRAGGGGPARPRLMPLHLDGPAPLSSSQLRSWFAYRVDGPSVVNNIPFAARLRGPCDVDAL VTAIGDVVNRHEILRTVYREIDGVPHQVVLPPEPVTVRRAHGDGEEWLRAELDRERAHVFDLEQDRPIRPAVLRVPDGVV LSVVMHHIAGDHWSATVLFADLLTAYRARAAGEAPAWAPLPLQYADFGAWQTALLADDAGIAGPQRDYWTRQLAGLPEET GLRPDFARPPVPSGRAEAVEFHIDGATRDKLTALCRELGVTEFMLLQAAVAVVLHKAGGGPDVPLGTPVAGRSEPELDQL VGFFINILVLRNDLRGNPTLREVCRRAREMALEAYAHQDLPFDQVVDAVSPVRTLARNPLFSVVVHVREQLPEDRVIAHG PDGDTTVTVLEPTFDAAHADLSLNFFASERGVDGGFSSGYRGHVIYRPELYSRETAQRFVGWLGRVVTAFADQPDLTLRD LEIGAPGEQRRILEKWGGGGVFVLDETLRPVPVGVVGDVYTAGGPLAAAHWGEAALTATRFVAHPYGADAGGRLHRTGDQ ARWSADGVLELVGAEGLAAEPAVRAAGHTAEPPATDTERALATLLADVLDVEVTRRHDDFFSLGGDSILAVQLAARARDA GLRLTARMVFEQPTLQDLAAAVDAAAETPGPAGDTAHAPMSASGLSADELAALTASWNASQEDTP >Mature_1744_residues TDTTELTGVDDTARLELLRRRLTERGLSSQHPRGTEPSTRELSEGQQRMWFVQAADPSGALLNVCVSYRIRGAVDLAALR GALDAVARRHPVLRTTYAADDTGAPRPTVHADLRPAWAEHDLTGLANQSEQAQRLRLEVLAQREFAAPFDLSTDAPLRIT MVHTGSDEYVMLLVAHHIAWDDGSWEVFFGDLTRAYAGEDLGEELEPHAPAVPRDAADDLAYWRRVMADPPEPLELPGPT GSAVPTGWRSARTGVALDADTARRVVDLARETGCTPYAVLLAVFGTLIHRYTHADDFLVATPVLNRGTGTEDRIGYYGNT VAMRLRPTTSMSFRDMLIQTRDTALGAFAHQGVNVDQVVRELNPDRRHGTERMTRVSFGFRGPDRFGFAPAGVHCERADL RSHLTQLPLGVMVEFDAEPSGGGAVVEVEHLVEIIEPALAQQLLDHFVVLLGSALDRPDTTLARLALMSAADAAWLHDVA RGDHFDTPPRTLPDLIAAQVATTPDEIAVAYEGRHYTYREINEQANRVAHWLIGQSIGAEDRVAVLLDKSPELIVTALGV AKAGAVYVPVDPTYPEDRLAFILGDCDAKLVLREPVSGLDGTPAHDPTDADRLRPLLPENTAYLIYTSGTTGLPKGVPVS HRPVAEYFVWFKADYQVDAKDRLLQVASPSFDVSIAEIFGMLACGARIVIHRPGGLNDIGYLTELLRDERITAMHFVPSL LGLFLSLPGVNQWRTLQRVPIGGEPLPGEVADKFHATFDALLHNFYGPTETVINASRYKVEGKQGTRIVPIGRPKINTQM HLLDDALQPVPVGVIGEIYIGGTHVAHGYHRRPGLTAERFVADPFTPGGRLYRSGDLARRNADGDIEFVGRADEQVKIRG FRIELGDVAAAISVDPSVGQAVVMVSELPNLGKSLVGYLTPVSGEDRDSVAVDRIRARVAAALPEYMVPAAYVVLDEVPI TTHGKIDRAALPAPELTSTADFREPGTDTEREMARLFGELLGRSANIGADDSFFDLGGHSLLATKLVAAVRTSCGVDIGV QEVFELATVAQLAGHVDALRAGGGGPARPRLMPLHLDGPAPLSSSQLRSWFAYRVDGPSVVNNIPFAARLRGPCDVDALV TAIGDVVNRHEILRTVYREIDGVPHQVVLPPEPVTVRRAHGDGEEWLRAELDRERAHVFDLEQDRPIRPAVLRVPDGVVL SVVMHHIAGDHWSATVLFADLLTAYRARAAGEAPAWAPLPLQYADFGAWQTALLADDAGIAGPQRDYWTRQLAGLPEETG LRPDFARPPVPSGRAEAVEFHIDGATRDKLTALCRELGVTEFMLLQAAVAVVLHKAGGGPDVPLGTPVAGRSEPELDQLV GFFINILVLRNDLRGNPTLREVCRRAREMALEAYAHQDLPFDQVVDAVSPVRTLARNPLFSVVVHVREQLPEDRVIAHGP DGDTTVTVLEPTFDAAHADLSLNFFASERGVDGGFSSGYRGHVIYRPELYSRETAQRFVGWLGRVVTAFADQPDLTLRDL EIGAPGEQRRILEKWGGGGVFVLDETLRPVPVGVVGDVYTAGGPLAAAHWGEAALTATRFVAHPYGADAGGRLHRTGDQA RWSADGVLELVGAEGLAAEPAVRAAGHTAEPPATDTERALATLLADVLDVEVTRRHDDFFSLGGDSILAVQLAARARDAG LRLTARMVFEQPTLQDLAAAVDAAAETPGPAGDTAHAPMSASGLSADELAALTASWNASQEDTP
Specific function: Specifically adenylates threonine and glycine, and loads them onto their corresponding peptidyl carrier domains [H]
COG id: COG1020
COG function: function code Q; Non-ribosomal peptide synthetase modules and related proteins
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 1 acyl carrier domain [H]
Homologues:
Organism=Homo sapiens, GI45580730, Length=467, Percent_Identity=24.1970021413276, Blast_Score=106, Evalue=2e-22, Organism=Homo sapiens, GI38505220, Length=499, Percent_Identity=22.8456913827655, Blast_Score=94, Evalue=2e-18, Organism=Homo sapiens, GI115511026, Length=508, Percent_Identity=23.2283464566929, Blast_Score=83, Evalue=2e-15, Organism=Homo sapiens, GI157311624, Length=516, Percent_Identity=23.8372093023256, Blast_Score=83, Evalue=3e-15, Organism=Homo sapiens, GI157311622, Length=516, Percent_Identity=23.8372093023256, Blast_Score=83, Evalue=3e-15, Organism=Homo sapiens, GI42544132, Length=509, Percent_Identity=21.2180746561886, Blast_Score=76, Evalue=3e-13, Organism=Homo sapiens, GI122937307, Length=360, Percent_Identity=25.2777777777778, Blast_Score=74, Evalue=1e-12, Organism=Homo sapiens, GI40807357, Length=539, Percent_Identity=21.8923933209648, Blast_Score=73, Evalue=2e-12, Organism=Homo sapiens, GI156151445, Length=355, Percent_Identity=22.5352112676056, Blast_Score=68, Evalue=7e-11, Organism=Escherichia coli, GI1786801, Length=600, Percent_Identity=37.1666666666667, Blast_Score=345, Evalue=2e-95, Organism=Escherichia coli, GI145693145, Length=542, Percent_Identity=25.6457564575646, Blast_Score=119, Evalue=1e-27, Organism=Escherichia coli, GI1788107, Length=546, Percent_Identity=23.992673992674, Blast_Score=100, Evalue=7e-22, Organism=Escherichia coli, GI221142682, Length=496, Percent_Identity=23.991935483871, Blast_Score=93, Evalue=2e-19, Organism=Escherichia coli, GI1786810, Length=526, Percent_Identity=23.7642585551331, Blast_Score=92, Evalue=3e-19, Organism=Caenorhabditis elegans, GI17556356, Length=571, Percent_Identity=26.6199649737303, Blast_Score=144, Evalue=4e-34, Organism=Caenorhabditis elegans, GI17550940, Length=495, Percent_Identity=22.8282828282828, Blast_Score=106, Evalue=1e-22, Organism=Caenorhabditis elegans, GI17560308, Length=523, Percent_Identity=22.9445506692161, Blast_Score=93, Evalue=2e-18, Organism=Caenorhabditis elegans, GI71994690, Length=547, Percent_Identity=20.4753199268739, Blast_Score=78, Evalue=5e-14, Organism=Caenorhabditis elegans, GI71994694, Length=547, Percent_Identity=20.4753199268739, Blast_Score=77, Evalue=6e-14, Organism=Caenorhabditis elegans, GI71994703, Length=550, Percent_Identity=20.7272727272727, Blast_Score=75, Evalue=5e-13, Organism=Saccharomyces cerevisiae, GI6319591, Length=915, Percent_Identity=25.0273224043716, Blast_Score=257, Evalue=1e-68, Organism=Saccharomyces cerevisiae, GI6319699, Length=354, Percent_Identity=22.5988700564972, Blast_Score=70, Evalue=3e-12, Organism=Drosophila melanogaster, GI24648676, Length=641, Percent_Identity=30.2652106084243, Blast_Score=239, Evalue=1e-62, Organism=Drosophila melanogaster, GI24581924, Length=373, Percent_Identity=24.9329758713137, Blast_Score=77, Evalue=1e-13,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR010071 - InterPro: IPR009081 - InterPro: IPR020845 - InterPro: IPR000873 - InterPro: IPR001242 - InterPro: IPR006163 - InterPro: IPR020806 - InterPro: IPR001031 [H]
Pfam domain/function: PF00501 AMP-binding; PF00668 Condensation; PF00550 PP-binding; PF00975 Thioesterase [H]
EC number: 2.7.7.- [C]
Molecular weight: Translated: 188778; Mature: 188647
Theoretical pI: Translated: 5.04; Mature: 5.04
Prosite motif: PS00012 PHOSPHOPANTETHEINE ; PS50075 ACP_DOMAIN ; PS00455 AMP_BINDING
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.5 %Cys (Translated Protein) 1.3 %Met (Translated Protein) 1.8 %Cys+Met (Translated Protein) 0.5 %Cys (Mature Protein) 1.3 %Met (Mature Protein) 1.8 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MTDTTELTGVDDTARLELLRRRLTERGLSSQHPRGTEPSTRELSEGQQRMWFVQAADPSG CCCCCCCCCCCHHHHHHHHHHHHHHCCCCCCCCCCCCCCHHHHHCCCCEEEEEEECCCCC ALLNVCVSYRIRGAVDLAALRGALDAVARRHPVLRTTYAADDTGAPRPTVHADLRPAWAE HHHHHHHHHHHCCHHHHHHHHHHHHHHHHCCCCEEEEECCCCCCCCCCCEECCCCCCHHH HDLTGLANQSEQAQRLRLEVLAQREFAAPFDLSTDAPLRITMVHTGSDEYVMLLVAHHIA CCHHHCCCCHHHHHHHHHHHHHHHHCCCCCCCCCCCCEEEEEEEECCCCEEEEEEEHHHE WDDGSWEVFFGDLTRAYAGEDLGEELEPHAPAVPRDAADDLAYWRRVMADPPEPLELPGP ECCCCEEEEECCHHHHHCCCHHHHHCCCCCCCCCCCCHHHHHHHHHHHCCCCCCCCCCCC TGSAVPTGWRSARTGVALDADTARRVVDLARETGCTPYAVLLAVFGTLIHRYTHADDFLV CCCCCCCCCHHCCCCEEECHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHCCCCCEEE ATPVLNRGTGTEDRIGYYGNTVAMRLRPTTSMSFRDMLIQTRDTALGAFAHQGVNVDQVV ECCCCCCCCCCCCCCCCCCCEEEEEEECCCCCHHHHHHHHHHHHHHHHHHHCCCCHHHHH RELNPDRRHGTERMTRVSFGFRGPDRFGFAPAGVHCERADLRSHLTQLPLGVMVEFDAEP HHCCCCHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHCCCCEEEEECCCC SGGGAVVEVEHLVEIIEPALAQQLLDHFVVLLGSALDRPDTTLARLALMSAADAAWLHDV CCCCCEEEHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHH ARGDHFDTPPRTLPDLIAAQVATTPDEIAVAYEGRHYTYREINEQANRVAHWLIGQSIGA HCCCCCCCCCHHHHHHHHHHHCCCCCCEEEEECCCCCHHHHHHHHHHHHHHHHHHCCCCC EDRVAVLLDKSPELIVTALGVAKAGAVYVPVDPTYPEDRLAFILGDCDAKLVLREPVSGL CCCEEEEECCCCCEEEEEHHHHCCCEEEEECCCCCCCCCEEEEEECCCCEEEEECCCCCC DGTPAHDPTDADRLRPLLPENTAYLIYTSGTTGLPKGVPVSHRPVAEYFVWFKADYQVDA CCCCCCCCCCHHHHCCCCCCCCEEEEEECCCCCCCCCCCCCCCCHHHEEEEEEECCEECH KDRLLQVASPSFDVSIAEIFGMLACGARIVIHRPGGLNDIGYLTELLRDERITAMHFVPS HHHHHHHCCCCCCEEHHHHHHHHHCCCEEEEECCCCCCHHHHHHHHHHCCCHHHHHHHHH LLGLFLSLPGVNQWRTLQRVPIGGEPLPGEVADKFHATFDALLHNFYGPTETVINASRYK HHHHHHCCCCCCHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHHCCCHHHHCCCCCEE VEGKQGTRIVPIGRPKINTQMHLLDDALQPVPVGVIGEIYIGGTHVAHGYHRRPGLTAER EECCCCCEEEECCCCCCCCHHHHHHHCCCCCCCCEEEEEEECCEEEECCCCCCCCCCHHH FVADPFTPGGRLYRSGDLARRNADGDIEFVGRADEQVKIRGFRIELGDVAAAISVDPSVG HCCCCCCCCCCEEECCCHHHCCCCCCEEEEECCCCEEEEEEEEEECCCEEEEEECCCCCC QAVVMVSELPNLGKSLVGYLTPVSGEDRDSVAVDRIRARVAAALPEYMVPAAYVVLDEVP CEEEEHHHCCHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHHHCCEEEEEEECCC ITTHGKIDRAALPAPELTSTADFREPGTDTEREMARLFGELLGRSANIGADDSFFDLGGH CCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHCCCCCCCCCCCEEECCCH SLLATKLVAAVRTSCGVDIGVQEVFELATVAQLAGHVDALRAGGGGPARPRLMPLHLDGP HHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCEEEEEECCC APLSSSQLRSWFAYRVDGPSVVNNIPFAARLRGPCDVDALVTAIGDVVNRHEILRTVYRE CCCCHHHHHHHHEEECCCCHHHHCCCCCEECCCCCCHHHHHHHHHHHHHHHHHHHHHHHH IDGVPHQVVLPPEPVTVRRAHGDGEEWLRAELDRERAHVFDLEQDRPIRPAVLRVPDGVV HCCCCCEEEECCCCCEEEECCCCHHHHHHHHHHHHHHHEECCCCCCCCCCEEEECCCHHH LSVVMHHIAGDHWSATVLFADLLTAYRARAAGEAPAWAPLPLQYADFGAWQTALLADDAG HHHHHHHHCCCCHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCHHHHEEECCCC IAGPQRDYWTRQLAGLPEETGLRPDFARPPVPSGRAEAVEFHIDGATRDKLTALCRELGV CCCCCHHHHHHHHCCCCHHCCCCCCCCCCCCCCCCCEEEEEEECCCCHHHHHHHHHHHCH TEFMLLQAAVAVVLHKAGGGPDVPLGTPVAGRSEPELDQLVGFFINILVLRNDLRGNPTL HHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHCCCCCCCHH REVCRRAREMALEAYAHQDLPFDQVVDAVSPVRTLARNPLFSVVVHVREQLPEDRVIAHG HHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHCHHHHHHHHHHHHCCCCCEEEEC PDGDTTVTVLEPTFDAAHADLSLNFFASERGVDGGFSSGYRGHVIYRPELYSRETAQRFV CCCCCEEEEECCCCCCCCCCEEEEEEECCCCCCCCCCCCCCCEEEECCCHHHHHHHHHHH GWLGRVVTAFADQPDLTLRDLEIGAPGEQRRILEKWGGGGVFVLDETLRPVPVGVVGDVY HHHHHHHHHHCCCCCCEEEEEECCCCCHHHHHHHHCCCCCEEEECCCCCCCCCCEECCCC TAGGPLAAAHWGEAALTATRFVAHPYGADAGGRLHRTGDQARWSADGVLELVGAEGLAAE CCCCCEEEHHCCCHHHHHHHHHCCCCCCCCCCCEECCCCCCCCCCCCHHEEECCCCCCCC PAVRAAGHTAEPPATDTERALATLLADVLDVEVTRRHDDFFSLGGDSILAVQLAARARDA CHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHCCCHHHHCCCCCEEEEEHHHHHHCC GLRLTARMVFEQPTLQDLAAAVDAAAETPGPAGDTAHAPMSASGLSADELAALTASWNAS CCEEEEHHHHCCCCHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCHHHHHHHHCCCCCC QEDTP CCCCC >Mature Secondary Structure TDTTELTGVDDTARLELLRRRLTERGLSSQHPRGTEPSTRELSEGQQRMWFVQAADPSG CCCCCCCCCCHHHHHHHHHHHHHHCCCCCCCCCCCCCCHHHHHCCCCEEEEEEECCCCC ALLNVCVSYRIRGAVDLAALRGALDAVARRHPVLRTTYAADDTGAPRPTVHADLRPAWAE HHHHHHHHHHHCCHHHHHHHHHHHHHHHHCCCCEEEEECCCCCCCCCCCEECCCCCCHHH HDLTGLANQSEQAQRLRLEVLAQREFAAPFDLSTDAPLRITMVHTGSDEYVMLLVAHHIA CCHHHCCCCHHHHHHHHHHHHHHHHCCCCCCCCCCCCEEEEEEEECCCCEEEEEEEHHHE WDDGSWEVFFGDLTRAYAGEDLGEELEPHAPAVPRDAADDLAYWRRVMADPPEPLELPGP ECCCCEEEEECCHHHHHCCCHHHHHCCCCCCCCCCCCHHHHHHHHHHHCCCCCCCCCCCC TGSAVPTGWRSARTGVALDADTARRVVDLARETGCTPYAVLLAVFGTLIHRYTHADDFLV CCCCCCCCCHHCCCCEEECHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHCCCCCEEE ATPVLNRGTGTEDRIGYYGNTVAMRLRPTTSMSFRDMLIQTRDTALGAFAHQGVNVDQVV ECCCCCCCCCCCCCCCCCCCEEEEEEECCCCCHHHHHHHHHHHHHHHHHHHCCCCHHHHH RELNPDRRHGTERMTRVSFGFRGPDRFGFAPAGVHCERADLRSHLTQLPLGVMVEFDAEP HHCCCCHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHCCCCEEEEECCCC SGGGAVVEVEHLVEIIEPALAQQLLDHFVVLLGSALDRPDTTLARLALMSAADAAWLHDV CCCCCEEEHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHH ARGDHFDTPPRTLPDLIAAQVATTPDEIAVAYEGRHYTYREINEQANRVAHWLIGQSIGA HCCCCCCCCCHHHHHHHHHHHCCCCCCEEEEECCCCCHHHHHHHHHHHHHHHHHHCCCCC EDRVAVLLDKSPELIVTALGVAKAGAVYVPVDPTYPEDRLAFILGDCDAKLVLREPVSGL CCCEEEEECCCCCEEEEEHHHHCCCEEEEECCCCCCCCCEEEEEECCCCEEEEECCCCCC DGTPAHDPTDADRLRPLLPENTAYLIYTSGTTGLPKGVPVSHRPVAEYFVWFKADYQVDA CCCCCCCCCCHHHHCCCCCCCCEEEEEECCCCCCCCCCCCCCCCHHHEEEEEEECCEECH KDRLLQVASPSFDVSIAEIFGMLACGARIVIHRPGGLNDIGYLTELLRDERITAMHFVPS HHHHHHHCCCCCCEEHHHHHHHHHCCCEEEEECCCCCCHHHHHHHHHHCCCHHHHHHHHH LLGLFLSLPGVNQWRTLQRVPIGGEPLPGEVADKFHATFDALLHNFYGPTETVINASRYK HHHHHHCCCCCCHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHHCCCHHHHCCCCCEE VEGKQGTRIVPIGRPKINTQMHLLDDALQPVPVGVIGEIYIGGTHVAHGYHRRPGLTAER EECCCCCEEEECCCCCCCCHHHHHHHCCCCCCCCEEEEEEECCEEEECCCCCCCCCCHHH FVADPFTPGGRLYRSGDLARRNADGDIEFVGRADEQVKIRGFRIELGDVAAAISVDPSVG HCCCCCCCCCCEEECCCHHHCCCCCCEEEEECCCCEEEEEEEEEECCCEEEEEECCCCCC QAVVMVSELPNLGKSLVGYLTPVSGEDRDSVAVDRIRARVAAALPEYMVPAAYVVLDEVP CEEEEHHHCCHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHHHCCEEEEEEECCC ITTHGKIDRAALPAPELTSTADFREPGTDTEREMARLFGELLGRSANIGADDSFFDLGGH CCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHCCCCCCCCCCCEEECCCH SLLATKLVAAVRTSCGVDIGVQEVFELATVAQLAGHVDALRAGGGGPARPRLMPLHLDGP HHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCEEEEEECCC APLSSSQLRSWFAYRVDGPSVVNNIPFAARLRGPCDVDALVTAIGDVVNRHEILRTVYRE CCCCHHHHHHHHEEECCCCHHHHCCCCCEECCCCCCHHHHHHHHHHHHHHHHHHHHHHHH IDGVPHQVVLPPEPVTVRRAHGDGEEWLRAELDRERAHVFDLEQDRPIRPAVLRVPDGVV HCCCCCEEEECCCCCEEEECCCCHHHHHHHHHHHHHHHEECCCCCCCCCCEEEECCCHHH LSVVMHHIAGDHWSATVLFADLLTAYRARAAGEAPAWAPLPLQYADFGAWQTALLADDAG HHHHHHHHCCCCHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCHHHHEEECCCC IAGPQRDYWTRQLAGLPEETGLRPDFARPPVPSGRAEAVEFHIDGATRDKLTALCRELGV CCCCCHHHHHHHHCCCCHHCCCCCCCCCCCCCCCCCEEEEEEECCCCHHHHHHHHHHHCH TEFMLLQAAVAVVLHKAGGGPDVPLGTPVAGRSEPELDQLVGFFINILVLRNDLRGNPTL HHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHCCCCCCCHH REVCRRAREMALEAYAHQDLPFDQVVDAVSPVRTLARNPLFSVVVHVREQLPEDRVIAHG HHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHCHHHHHHHHHHHHCCCCCEEEEC PDGDTTVTVLEPTFDAAHADLSLNFFASERGVDGGFSSGYRGHVIYRPELYSRETAQRFV CCCCCEEEEECCCCCCCCCCEEEEEEECCCCCCCCCCCCCCCEEEECCCHHHHHHHHHHH GWLGRVVTAFADQPDLTLRDLEIGAPGEQRRILEKWGGGGVFVLDETLRPVPVGVVGDVY HHHHHHHHHHCCCCCCEEEEEECCCCCHHHHHHHHCCCCCEEEECCCCCCCCCCEECCCC TAGGPLAAAHWGEAALTATRFVAHPYGADAGGRLHRTGDQARWSADGVLELVGAEGLAAE CCCCCEEEHHCCCHHHHHHHHHCCCCCCCCCCCEECCCCCCCCCCCCHHEEECCCCCCCC PAVRAAGHTAEPPATDTERALATLLADVLDVEVTRRHDDFFSLGGDSILAVQLAARARDA CHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHCCCHHHHCCCCCEEEEEHHHHHHCC GLRLTARMVFEQPTLQDLAAAVDAAAETPGPAGDTAHAPMSASGLSADELAALTASWNAS CCEEEEHHHHCCCCHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCHHHHHHHHCCCCCC QEDTP CCCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: Phosphopantetheine. [C]
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: 6 ATP; L-serine; 2,3-dihydroxybenzoate [C]
Specific reaction: 6 ATP + 3 L-serine + 3 2,3-dihydroxybenzoate = 6 pyrophosphate + 6 AMP + enterobactin ATP + L-serine = pyrophosphate + L-Seryl-AMP 6 ATP + 3 L-serine + 3 2,3-dihydroxybenzoate = 6 pyrophosphate + 6 AMP + enterobactin ATP + L-serine = pyrophosphate + L-Ser
General reaction: Transferases; Acyltransferases; Transferring groups other than amino-acyl groups [C]
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 11112781; 9384377; 10568751; 8550523 [H]