Definition Ruegeria sp. TM1040, complete genome.
Accession NC_008044
Length 3,200,938

Click here to switch to the map view.

The map label for this gene is alkK [H]

Identifier: 99081011

GI number: 99081011

Start: 1259585

End: 1261216

Strand: Reverse

Name: alkK [H]

Synonym: TM1040_1170

Alternate gene names: 99081011

Gene position: 1261216-1259585 (Counterclockwise)

Preceding gene: 99081012

Following gene: 99081010

Centisome position: 39.4

GC content: 60.23

Gene sequence:

>1632_bases
ATGAGCGCCAACCCCTACAATACCGATCTGGATCGCACCCCGGCCAACTATCAGCCCCTGACCCCGCTCATGTTTCTGGA
GCGGGCCGCAACGGTATTTCCAGAGCACACGGCAATCATTCACGGCCCCCTTCGACGCAGCTACGCCGCTTTTTATGCAC
GCGCGCGCCAGCTTGGCTCGGCACTGTCGCATAGGGGCATCACGCGGGGCGATACGGTCTCGGCCCTGCTGCCAAACACG
TCCGCGATGCTTGAGTGTCACTATGGCGTCCCCATGTGCGGTGCGGTGCTGCATTCGATCAACACCCGGCTTGATGCTGC
GATCATCGCCTTTCAGCTGGATCACGCGATGTCCAAGGTCGTCATCGTCGACTCTGAATTCATGCCCTTGATGCAGGAGG
CGCTGGCGCTTTGCTCGGTGCAGCCCCTGCTGATCGAGGTCGACGATCCCGTCTACGAGGGCGCGCGGATCAAAACCGAA
GCCGTGGACTACGATAGCTTTATTGCGGATGGTGACGCCGAGTTTGCCTGGCTCATGCCCGAAGACGAATGGGACGCGAT
CTCGATCAACTACACCTCGGGCACCACCGGAGACCCCAAGGGGGTCGTTTCGCATCATCGCGGGGCCTATCTTTTGGCGC
AGGGCAATGCGCTCACGACAACGATGGGCAAACATGCGGTCTATCTCTGGACCCTGCCGATGTTTCACTGCAACGGCTGG
TGTTTTCCCTGGACGCTCTCGGCGATCATTGGCACCCATGTCTGCCTGCGCCAGGTGCGGGCGGATCAGATCTGGAACGC
GCTCGCCGACGAGGGCGTCACGCATCTCTGTGGCGCGCCCATCGTGATGTCGCTGATGATCTCGGCCCCCGCCGACGTGC
AGCGCCCCCTCGATCAGACCGTTCAGTTTTTTACAGCCGCTGCCCCGCCGCCGGAAAAGCTGCTGGCGGACATGAAAACC
GCAGGCTTTGAAGTCACGCATCTTTATGGACTCACAGAAACCTATGGCCCTGCCGTGGTCAACGACTGGCATCAAAGCTG
GTCCGAGCTGCCGCACGACGAACAGTCCCGCCTGAAATCCCGGCAGGGCGTGCGCTATCTTCCGCTCGAGGGACTCAACG
TTCTGGACCCCGAAACCCTAGAGCCCGTGCCCCATGATGGCGAAACCATGGGCGAGGTCATGTTTCGCGGCAATGTCGTG
ATGAAGGGCTATTTTCGCAATCCTGACGCCACCCGAAAAGCCTTTGAGGGGGGCTGGTTTCATTCCGGCGATCTGGGTGT
TGTTCATCCTGACGGCTATATCCAGCTCAAGGACCGCTCGAAGGATGTCATTATTTCCGGCGGAGAGAATATCTCCTCCA
TCGAGGTCGAAGAGGCGCTGTATCGCCATCCCGCGATTGCCGTCACCGCCGTTGTCGCCATGCCCGACGAGAAATGGGGC
GAAACACCATGCGCCTTCATCGAGCTGGCCGAAGGTGCAGAGATCGACACCGATGCGCTCAGGCAATGGTGTCGTGACCA
ACTCGCCCCCTACAAGGTGCCGCGCAAATTTGTCCTGACCGAAATCCCGCGCACCTCAACCGGGAAAATCCAGAAATTCG
CCCTGCGGGAACAGGCGAAGTCGCTCTGCTGA

Upstream 100 bases:

>100_bases
GCGGACGTGATGGTCAAAAACATGTTGGCGCAGGATGCCGCAGAAGGCATCAATGCCTTTGTCGAAAAACGTTCCCCGCA
ATGGCAGGATGCATAAGCCG

Downstream 100 bases:

>100_bases
TCTGCGCCGCGCAAGGTGCCGATACGCGATCTGTGCTGGGGGATCAGACCCTCGGCGCAGTTCCACCAGGGCGTGGGCGC
GTTGTGACAAATTTCGACCC

Product: acyl-CoA synthetase

Products: NA

Alternate protein names: Medium-chain acyl-CoA synthetase [H]

Number of amino acids: Translated: 543; Mature: 542

Protein sequence:

>543_residues
MSANPYNTDLDRTPANYQPLTPLMFLERAATVFPEHTAIIHGPLRRSYAAFYARARQLGSALSHRGITRGDTVSALLPNT
SAMLECHYGVPMCGAVLHSINTRLDAAIIAFQLDHAMSKVVIVDSEFMPLMQEALALCSVQPLLIEVDDPVYEGARIKTE
AVDYDSFIADGDAEFAWLMPEDEWDAISINYTSGTTGDPKGVVSHHRGAYLLAQGNALTTTMGKHAVYLWTLPMFHCNGW
CFPWTLSAIIGTHVCLRQVRADQIWNALADEGVTHLCGAPIVMSLMISAPADVQRPLDQTVQFFTAAAPPPEKLLADMKT
AGFEVTHLYGLTETYGPAVVNDWHQSWSELPHDEQSRLKSRQGVRYLPLEGLNVLDPETLEPVPHDGETMGEVMFRGNVV
MKGYFRNPDATRKAFEGGWFHSGDLGVVHPDGYIQLKDRSKDVIISGGENISSIEVEEALYRHPAIAVTAVVAMPDEKWG
ETPCAFIELAEGAEIDTDALRQWCRDQLAPYKVPRKFVLTEIPRTSTGKIQKFALREQAKSLC

Sequences:

>Translated_543_residues
MSANPYNTDLDRTPANYQPLTPLMFLERAATVFPEHTAIIHGPLRRSYAAFYARARQLGSALSHRGITRGDTVSALLPNT
SAMLECHYGVPMCGAVLHSINTRLDAAIIAFQLDHAMSKVVIVDSEFMPLMQEALALCSVQPLLIEVDDPVYEGARIKTE
AVDYDSFIADGDAEFAWLMPEDEWDAISINYTSGTTGDPKGVVSHHRGAYLLAQGNALTTTMGKHAVYLWTLPMFHCNGW
CFPWTLSAIIGTHVCLRQVRADQIWNALADEGVTHLCGAPIVMSLMISAPADVQRPLDQTVQFFTAAAPPPEKLLADMKT
AGFEVTHLYGLTETYGPAVVNDWHQSWSELPHDEQSRLKSRQGVRYLPLEGLNVLDPETLEPVPHDGETMGEVMFRGNVV
MKGYFRNPDATRKAFEGGWFHSGDLGVVHPDGYIQLKDRSKDVIISGGENISSIEVEEALYRHPAIAVTAVVAMPDEKWG
ETPCAFIELAEGAEIDTDALRQWCRDQLAPYKVPRKFVLTEIPRTSTGKIQKFALREQAKSLC
>Mature_542_residues
SANPYNTDLDRTPANYQPLTPLMFLERAATVFPEHTAIIHGPLRRSYAAFYARARQLGSALSHRGITRGDTVSALLPNTS
AMLECHYGVPMCGAVLHSINTRLDAAIIAFQLDHAMSKVVIVDSEFMPLMQEALALCSVQPLLIEVDDPVYEGARIKTEA
VDYDSFIADGDAEFAWLMPEDEWDAISINYTSGTTGDPKGVVSHHRGAYLLAQGNALTTTMGKHAVYLWTLPMFHCNGWC
FPWTLSAIIGTHVCLRQVRADQIWNALADEGVTHLCGAPIVMSLMISAPADVQRPLDQTVQFFTAAAPPPEKLLADMKTA
GFEVTHLYGLTETYGPAVVNDWHQSWSELPHDEQSRLKSRQGVRYLPLEGLNVLDPETLEPVPHDGETMGEVMFRGNVVM
KGYFRNPDATRKAFEGGWFHSGDLGVVHPDGYIQLKDRSKDVIISGGENISSIEVEEALYRHPAIAVTAVVAMPDEKWGE
TPCAFIELAEGAEIDTDALRQWCRDQLAPYKVPRKFVLTEIPRTSTGKIQKFALREQAKSLC

Specific function: Unknown

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasm [H]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the ATP-dependent AMP-binding enzyme family [H]

Homologues:

Organism=Homo sapiens, GI156151445, Length=553, Percent_Identity=26.7631103074141, Blast_Score=164, Evalue=1e-40,
Organism=Homo sapiens, GI187761345, Length=543, Percent_Identity=28.3609576427256, Blast_Score=151, Evalue=1e-36,
Organism=Homo sapiens, GI187761343, Length=543, Percent_Identity=28.3609576427256, Blast_Score=151, Evalue=1e-36,
Organism=Homo sapiens, GI157311624, Length=493, Percent_Identity=26.9776876267748, Blast_Score=129, Evalue=9e-30,
Organism=Homo sapiens, GI157311622, Length=493, Percent_Identity=26.9776876267748, Blast_Score=129, Evalue=9e-30,
Organism=Homo sapiens, GI58082049, Length=516, Percent_Identity=26.5503875968992, Blast_Score=127, Evalue=3e-29,
Organism=Homo sapiens, GI38505220, Length=518, Percent_Identity=25.6756756756757, Blast_Score=120, Evalue=4e-27,
Organism=Homo sapiens, GI122937307, Length=520, Percent_Identity=25.7692307692308, Blast_Score=118, Evalue=2e-26,
Organism=Homo sapiens, GI42544132, Length=510, Percent_Identity=24.5098039215686, Blast_Score=112, Evalue=8e-25,
Organism=Homo sapiens, GI115511026, Length=490, Percent_Identity=24.4897959183673, Blast_Score=99, Evalue=7e-21,
Organism=Homo sapiens, GI28416953, Length=136, Percent_Identity=32.3529411764706, Blast_Score=70, Evalue=5e-12,
Organism=Escherichia coli, GI145693145, Length=530, Percent_Identity=27.7358490566038, Blast_Score=157, Evalue=2e-39,
Organism=Escherichia coli, GI221142682, Length=511, Percent_Identity=25.6360078277886, Blast_Score=149, Evalue=6e-37,
Organism=Escherichia coli, GI1788107, Length=570, Percent_Identity=23.1578947368421, Blast_Score=140, Evalue=2e-34,
Organism=Escherichia coli, GI1786810, Length=539, Percent_Identity=25.974025974026, Blast_Score=126, Evalue=4e-30,
Organism=Escherichia coli, GI1788595, Length=352, Percent_Identity=25.5681818181818, Blast_Score=89, Evalue=8e-19,
Organism=Escherichia coli, GI1790505, Length=556, Percent_Identity=23.2014388489209, Blast_Score=80, Evalue=3e-16,
Organism=Caenorhabditis elegans, GI71994703, Length=571, Percent_Identity=26.7950963222417, Blast_Score=188, Evalue=7e-48,
Organism=Caenorhabditis elegans, GI71994690, Length=571, Percent_Identity=26.7950963222417, Blast_Score=187, Evalue=9e-48,
Organism=Caenorhabditis elegans, GI71994694, Length=541, Percent_Identity=26.9870609981516, Blast_Score=187, Evalue=1e-47,
Organism=Caenorhabditis elegans, GI17560308, Length=543, Percent_Identity=27.8084714548803, Blast_Score=171, Evalue=1e-42,
Organism=Caenorhabditis elegans, GI17558820, Length=512, Percent_Identity=27.9296875, Blast_Score=148, Evalue=6e-36,
Organism=Caenorhabditis elegans, GI17559526, Length=494, Percent_Identity=23.4817813765182, Blast_Score=136, Evalue=4e-32,
Organism=Caenorhabditis elegans, GI32563687, Length=526, Percent_Identity=23.0038022813688, Blast_Score=123, Evalue=2e-28,
Organism=Caenorhabditis elegans, GI17538037, Length=521, Percent_Identity=24.5681381957774, Blast_Score=114, Evalue=2e-25,
Organism=Caenorhabditis elegans, GI17557194, Length=514, Percent_Identity=22.3735408560311, Blast_Score=105, Evalue=6e-23,
Organism=Caenorhabditis elegans, GI17531443, Length=501, Percent_Identity=21.3572854291417, Blast_Score=105, Evalue=7e-23,
Organism=Caenorhabditis elegans, GI17560140, Length=526, Percent_Identity=22.6235741444867, Blast_Score=94, Evalue=1e-19,
Organism=Caenorhabditis elegans, GI71985884, Length=429, Percent_Identity=25.8741258741259, Blast_Score=82, Evalue=7e-16,
Organism=Caenorhabditis elegans, GI71996755, Length=150, Percent_Identity=33.3333333333333, Blast_Score=76, Evalue=5e-14,
Organism=Caenorhabditis elegans, GI17564090, Length=91, Percent_Identity=36.2637362637363, Blast_Score=65, Evalue=7e-11,
Organism=Saccharomyces cerevisiae, GI6319699, Length=508, Percent_Identity=25.1968503937008, Blast_Score=112, Evalue=1e-25,
Organism=Saccharomyces cerevisiae, GI6323182, Length=579, Percent_Identity=24.8704663212435, Blast_Score=92, Evalue=2e-19,
Organism=Drosophila melanogaster, GI24581924, Length=555, Percent_Identity=26.3063063063063, Blast_Score=140, Evalue=3e-33,
Organism=Drosophila melanogaster, GI18859661, Length=518, Percent_Identity=25.0965250965251, Blast_Score=116, Evalue=3e-26,
Organism=Drosophila melanogaster, GI21355181, Length=368, Percent_Identity=27.445652173913, Blast_Score=106, Evalue=4e-23,
Organism=Drosophila melanogaster, GI19922652, Length=507, Percent_Identity=22.879684418146, Blast_Score=81, Evalue=2e-15,
Organism=Drosophila melanogaster, GI19921316, Length=219, Percent_Identity=31.0502283105023, Blast_Score=77, Evalue=2e-14,
Organism=Drosophila melanogaster, GI21356441, Length=502, Percent_Identity=20.7171314741036, Blast_Score=75, Evalue=1e-13,
Organism=Drosophila melanogaster, GI20130357, Length=150, Percent_Identity=28.6666666666667, Blast_Score=69, Evalue=6e-12,
Organism=Drosophila melanogaster, GI24648260, Length=182, Percent_Identity=26.9230769230769, Blast_Score=69, Evalue=9e-12,
Organism=Drosophila melanogaster, GI21356947, Length=498, Percent_Identity=19.8795180722892, Blast_Score=69, Evalue=1e-11,
Organism=Drosophila melanogaster, GI281365686, Length=214, Percent_Identity=25.7009345794392, Blast_Score=68, Evalue=1e-11,
Organism=Drosophila melanogaster, GI21358303, Length=194, Percent_Identity=26.2886597938144, Blast_Score=66, Evalue=7e-11,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR020845
- InterPro:   IPR000873 [H]

Pfam domain/function: PF00501 AMP-binding [H]

EC number: NA

Molecular weight: Translated: 60068; Mature: 59937

Theoretical pI: Translated: 5.13; Mature: 5.13

Prosite motif: PS00455 AMP_BINDING

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.8 %Cys     (Translated Protein)
3.1 %Met     (Translated Protein)
5.0 %Cys+Met (Translated Protein)
1.8 %Cys     (Mature Protein)
3.0 %Met     (Mature Protein)
4.8 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSANPYNTDLDRTPANYQPLTPLMFLERAATVFPEHTAIIHGPLRRSYAAFYARARQLGS
CCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHCCCCCEEEECHHHHHHHHHHHHHHHHHH
ALSHRGITRGDTVSALLPNTSAMLECHYGVPMCGAVLHSINTRLDAAIIAFQLDHAMSKV
HHHHCCCCCCCCEEEECCCCCCEEEEECCCCHHHHHHHHHHHHHHHHHHHHHHHHHHCEE
VIVDSEFMPLMQEALALCSVQPLLIEVDDPVYEGARIKTEAVDYDSFIADGDAEFAWLMP
EEECCHHHHHHHHHHHHHCCCCEEEEECCCCCCCCEEEEEEECCHHHCCCCCCCEEEECC
EDEWDAISINYTSGTTGDPKGVVSHHRGAYLLAQGNALTTTMGKHAVYLWTLPMFHCNGW
CCCCCEEEEEECCCCCCCCCHHHHCCCCEEEEECCCEEEEECCCCEEEEEEEHHHHCCCC
CFPWTLSAIIGTHVCLRQVRADQIWNALADEGVTHLCGAPIVMSLMISAPADVQRPLDQT
CHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHCCHHHHHHHHHCCCHHHHHHHHHH
VQFFTAAAPPPEKLLADMKTAGFEVTHLYGLTETYGPAVVNDWHQSWSELPHDEQSRLKS
HHHHHCCCCCHHHHHHHHHHCCEEEEEEEECHHHCCCHHHHHHHHHHHHCCCCHHHHHHH
RQGVRYLPLEGLNVLDPETLEPVPHDGETMGEVMFRGNVVMKGYFRNPDATRKAFEGGWF
HCCCEEECCCCCCCCCCCCCCCCCCCCHHHHHHHEECCEEEEEEECCCCHHHHHHCCCCE
HSGDLGVVHPDGYIQLKDRSKDVIISGGENISSIEVEEALYRHPAIAVTAVVAMPDEKWG
ECCCEEEECCCCEEEEECCCCEEEEECCCCCCHHHHHHHHHHCCCEEEEEEEECCCHHCC
ETPCAFIELAEGAEIDTDALRQWCRDQLAPYKVPRKFVLTEIPRTSTGKIQKFALREQAK
CCCEEEEEECCCCCCCHHHHHHHHHHCCCCCCCCCHHHHCCCCCCCCCHHHHHHHHHHHH
SLC
HCC
>Mature Secondary Structure 
SANPYNTDLDRTPANYQPLTPLMFLERAATVFPEHTAIIHGPLRRSYAAFYARARQLGS
CCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHCCCCCEEEECHHHHHHHHHHHHHHHHHH
ALSHRGITRGDTVSALLPNTSAMLECHYGVPMCGAVLHSINTRLDAAIIAFQLDHAMSKV
HHHHCCCCCCCCEEEECCCCCCEEEEECCCCHHHHHHHHHHHHHHHHHHHHHHHHHHCEE
VIVDSEFMPLMQEALALCSVQPLLIEVDDPVYEGARIKTEAVDYDSFIADGDAEFAWLMP
EEECCHHHHHHHHHHHHHCCCCEEEEECCCCCCCCEEEEEEECCHHHCCCCCCCEEEECC
EDEWDAISINYTSGTTGDPKGVVSHHRGAYLLAQGNALTTTMGKHAVYLWTLPMFHCNGW
CCCCCEEEEEECCCCCCCCCHHHHCCCCEEEEECCCEEEEECCCCEEEEEEEHHHHCCCC
CFPWTLSAIIGTHVCLRQVRADQIWNALADEGVTHLCGAPIVMSLMISAPADVQRPLDQT
CHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHCCHHHHHHHHHCCCHHHHHHHHHH
VQFFTAAAPPPEKLLADMKTAGFEVTHLYGLTETYGPAVVNDWHQSWSELPHDEQSRLKS
HHHHHCCCCCHHHHHHHHHHCCEEEEEEEECHHHCCCHHHHHHHHHHHHCCCCHHHHHHH
RQGVRYLPLEGLNVLDPETLEPVPHDGETMGEVMFRGNVVMKGYFRNPDATRKAFEGGWF
HCCCEEECCCCCCCCCCCCCCCCCCCCHHHHHHHEECCEEEEEEECCCCHHHHHHCCCCE
HSGDLGVVHPDGYIQLKDRSKDVIISGGENISSIEVEEALYRHPAIAVTAVVAMPDEKWG
ECCCEEEECCCCEEEEECCCCEEEEECCCCCCHHHHHHHHHHCCCEEEEEEEECCCHHCC
ETPCAFIELAEGAEIDTDALRQWCRDQLAPYKVPRKFVLTEIPRTSTGKIQKFALREQAK
CCCEEEEEECCCCCCCHHHHHHHHHHCCCCCCCCCHHHHCCCCCCCCCHHHHHHHHHHHH
SLC
HCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 1453953 [H]