Definition Nitrosospira multiformis ATCC 25196 chromosome, complete genome.
Accession NC_007614
Length 3,184,243

Click here to switch to the map view.

The map label for this gene is cls [H]

Identifier: 82702836

GI number: 82702836

Start: 1954874

End: 1956511

Strand: Direct

Name: cls [H]

Synonym: Nmul_A1712

Alternate gene names: 82702836

Gene position: 1954874-1956511 (Clockwise)

Preceding gene: 82702835

Following gene: 82702837

Centisome position: 61.39

GC content: 55.13

Gene sequence:

>1638_bases
ATGGCCAAGTTCAAGCTGACACACCTGCTGCGCGAGATTCCCCATGAAACCGCGCGGGAGGATGCTTCTGCCAGAATCAT
GGCAGCCCAGGCGTTTTCGCGCGCCGCAGGCGCGCCTTTGGTGCATGGCAACAGCATCCGTCTCCTCAAGGATGCAAGCG
AGAATTATCCTGCATGGCTCGACGCGATCCGGTCGGCTGAAAAGAACGTCTATTTTGAAAATTATATTATTCGTAATGAC
ATCATTGGCCAGCGATTTGCCGATGCCCTCATTGCGAAAGCAAAAGAAGGCATACGGGTAAGATTACTTTATGACTGGCT
TGGAGGATTGACTGAAACATCATCCAATTTCTGGCGCCACCTGAGCAATGGAGGTGTGGAAGTTCGATGCTTCAATCCGA
TGCGCTTTGACAGTCCCCTGGCCTGGTTGAGCCGGCTGCATCGCAAATCGGTCTGCGTGGATGACCGTGTTGCATTTGTC
AGTGGATTATGCGTCGGGCAGATGTGGGATGGATACCCCGAGCGGAATATTGCGCCCTGGCGGGATACGGGAGTCGAGCT
GCGGGGGCCGGTGGTAGCGGACGTCATAAATTCCTTTGCGCGTGCATGGGCGGAGACGGGACCGGAAATACCTGCGGATG
AACTGCCTGCTCCCGATTCAATCCCGATTGCGGGTCACATCGATGTGAGAGTACTGGGAAACTTTGCTGCGACTGCGGGC
TTATACCGACTGGAGCAGCTGATCACCGTGCTGGCGCAAAAAACGCTTTGGCTTACCGATGCCTATTTCGTTGGGACTAC
AAGTTATGTGCAAGCGTTGAGAGGCGCGGCAATGGACAATGTAGATGTCCGCTTGCTTGTTCCCGGGTCAAGCGGGGATC
TCAAGTTTCTCAGGCCGATTTCGCGCGCCGGTTATCGTCCGTTGCTGGAAGCCGGCGTACGCGTGTTCGAGTGGAATGGC
TCGATGCTGCACGCCAAGACAGCCGTTGCCGATGGGCGTTGGGCCCGCGTTGGCTCAAGCAATCTCAATATGGCGAGCTG
GCTGGGAAATTGGGAACTGGATATTGCGGTGGAAAACCTGGATTTTGCCCAGAAAATGGAGCAAATGTACCTGGAGGATC
TGGAAAATTCAACCGAAATCGTTCTCAATAAAAAGAACCGGGTTCGCCCCATAGTGGATCAACTTCCCCACCGCCCTCGC
CGTCAGTACGGGGTTGTCAGGCGCCGGTCCGGAAGCGCGAGCAGGCTGACAGCCGGTGCCCTGCGTGTAGGCAATACTGT
CGGAGCGGCTATCACCAGTCGACTCGTCCTGGGAGCTGCCGAGGCAAAAATCATGTTTTTCGGGGGGGTTACGCTGCTTG
CTTTGACGGTCATTGCATTGTTGGAGCCCCTGCTCATGGTAATTCCTTTCTCGCTGCTTGCGGGATGGATCGGGATTTCA
CTGTTGATACAGGCGCACAGATTGCACAGGAACGGGCAGAATGATGCCGCAGCCCAGAATGCCAGTATTGCGTCCGATGA
GGCTCAGGATAAAGTGATCGAGCTTCCCAACTCCGTGCGCGAAGGCCAGCAGCCCAAAGATATCCGGAAAGAAGCCCAGG
AAACACAGGAAATTCAGAAAGCACTCAGGCAACAATGA

Upstream 100 bases:

>100_bases
GAGAAGAGGTTACGGACTAGGATTGGGGAAATATAAAAAGGTGGAGGAAAAGAAAGATCTGCCAGGGAACATACGCGAGA
GAGAACGGATCAAATAGCCT

Downstream 100 bases:

>100_bases
GAAGAACTGGTGGCGCGCAGGGGGAATTGAGTTTCTTCTGATCTCAATCGGCTTCAGGTTATTCCCCACCAAATCCTTTT
TCTTGACCTCCAGATTCTCT

Product: phospholipase D/transphosphatidylase

Products: CMP; 3(3-sn-phosphatidyl)-sn-glycerol 1-phosphate

Alternate protein names: CL synthase [H]

Number of amino acids: Translated: 545; Mature: 544

Protein sequence:

>545_residues
MAKFKLTHLLREIPHETAREDASARIMAAQAFSRAAGAPLVHGNSIRLLKDASENYPAWLDAIRSAEKNVYFENYIIRND
IIGQRFADALIAKAKEGIRVRLLYDWLGGLTETSSNFWRHLSNGGVEVRCFNPMRFDSPLAWLSRLHRKSVCVDDRVAFV
SGLCVGQMWDGYPERNIAPWRDTGVELRGPVVADVINSFARAWAETGPEIPADELPAPDSIPIAGHIDVRVLGNFAATAG
LYRLEQLITVLAQKTLWLTDAYFVGTTSYVQALRGAAMDNVDVRLLVPGSSGDLKFLRPISRAGYRPLLEAGVRVFEWNG
SMLHAKTAVADGRWARVGSSNLNMASWLGNWELDIAVENLDFAQKMEQMYLEDLENSTEIVLNKKNRVRPIVDQLPHRPR
RQYGVVRRRSGSASRLTAGALRVGNTVGAAITSRLVLGAAEAKIMFFGGVTLLALTVIALLEPLLMVIPFSLLAGWIGIS
LLIQAHRLHRNGQNDAAAQNASIASDEAQDKVIELPNSVREGQQPKDIRKEAQETQEIQKALRQQ

Sequences:

>Translated_545_residues
MAKFKLTHLLREIPHETAREDASARIMAAQAFSRAAGAPLVHGNSIRLLKDASENYPAWLDAIRSAEKNVYFENYIIRND
IIGQRFADALIAKAKEGIRVRLLYDWLGGLTETSSNFWRHLSNGGVEVRCFNPMRFDSPLAWLSRLHRKSVCVDDRVAFV
SGLCVGQMWDGYPERNIAPWRDTGVELRGPVVADVINSFARAWAETGPEIPADELPAPDSIPIAGHIDVRVLGNFAATAG
LYRLEQLITVLAQKTLWLTDAYFVGTTSYVQALRGAAMDNVDVRLLVPGSSGDLKFLRPISRAGYRPLLEAGVRVFEWNG
SMLHAKTAVADGRWARVGSSNLNMASWLGNWELDIAVENLDFAQKMEQMYLEDLENSTEIVLNKKNRVRPIVDQLPHRPR
RQYGVVRRRSGSASRLTAGALRVGNTVGAAITSRLVLGAAEAKIMFFGGVTLLALTVIALLEPLLMVIPFSLLAGWIGIS
LLIQAHRLHRNGQNDAAAQNASIASDEAQDKVIELPNSVREGQQPKDIRKEAQETQEIQKALRQQ
>Mature_544_residues
AKFKLTHLLREIPHETAREDASARIMAAQAFSRAAGAPLVHGNSIRLLKDASENYPAWLDAIRSAEKNVYFENYIIRNDI
IGQRFADALIAKAKEGIRVRLLYDWLGGLTETSSNFWRHLSNGGVEVRCFNPMRFDSPLAWLSRLHRKSVCVDDRVAFVS
GLCVGQMWDGYPERNIAPWRDTGVELRGPVVADVINSFARAWAETGPEIPADELPAPDSIPIAGHIDVRVLGNFAATAGL
YRLEQLITVLAQKTLWLTDAYFVGTTSYVQALRGAAMDNVDVRLLVPGSSGDLKFLRPISRAGYRPLLEAGVRVFEWNGS
MLHAKTAVADGRWARVGSSNLNMASWLGNWELDIAVENLDFAQKMEQMYLEDLENSTEIVLNKKNRVRPIVDQLPHRPRR
QYGVVRRRSGSASRLTAGALRVGNTVGAAITSRLVLGAAEAKIMFFGGVTLLALTVIALLEPLLMVIPFSLLAGWIGISL
LIQAHRLHRNGQNDAAAQNASIASDEAQDKVIELPNSVREGQQPKDIRKEAQETQEIQKALRQQ

Specific function: Catalyzes the reversible phosphatidyl group transfer from one phosphatidylglycerol molecule to another to form cardiolipin (CL) (diphosphatidylglycerol) and glycerol [H]

COG id: COG1502

COG function: function code I; Phosphatidylserine/phosphatidylglycerophosphate/cardiolipin synthases and related enzymes

Gene ontology:

Cell location: Cell membrane; Multi-pass membrane protein [H]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 2 PLD phosphodiesterase domains [H]

Homologues:

Organism=Escherichia coli, GI1787007, Length=337, Percent_Identity=29.3768545994065, Blast_Score=125, Evalue=6e-30,
Organism=Escherichia coli, GI1787502, Length=370, Percent_Identity=25.6756756756757, Blast_Score=113, Evalue=3e-26,
Organism=Escherichia coli, GI87081826, Length=381, Percent_Identity=26.7716535433071, Blast_Score=83, Evalue=4e-17,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR022924
- InterPro:   IPR001736 [H]

Pfam domain/function: PF00614 PLDc [H]

EC number: 2.7.8.5

Molecular weight: Translated: 60384; Mature: 60253

Theoretical pI: Translated: 9.21; Mature: 9.21

Prosite motif: PS50035 PLD

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.6 %Cys     (Translated Protein)
2.0 %Met     (Translated Protein)
2.6 %Cys+Met (Translated Protein)
0.6 %Cys     (Mature Protein)
1.8 %Met     (Mature Protein)
2.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MAKFKLTHLLREIPHETAREDASARIMAAQAFSRAAGAPLVHGNSIRLLKDASENYPAWL
CCCHHHHHHHHHCCHHHHHCCHHHHHHHHHHHHHHCCCCEEECCCEEEEECCCCCCHHHH
DAIRSAEKNVYFENYIIRNDIIGQRFADALIAKAKEGIRVRLLYDWLGGLTETSSNFWRH
HHHHHHHCCEEEHHEEEHHHHHHHHHHHHHHHHHCCCCEEEEEEHHHCCHHHHHHHHHHH
LSNGGVEVRCFNPMRFDSPLAWLSRLHRKSVCVDDRVAFVSGLCVGQMWDGYPERNIAPW
HCCCCEEEEEECCCCCCCHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHCCCCCCCCCCCC
RDTGVELRGPVVADVINSFARAWAETGPEIPADELPAPDSIPIAGHIDVRVLGNFAATAG
CCCCCCCCCCHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCEECCEEEEEHHHHHHHHH
LYRLEQLITVLAQKTLWLTDAYFVGTTSYVQALRGAAMDNVDVRLLVPGSSGDLKFLRPI
HHHHHHHHHHHHHHHHHEECHHHHCCHHHHHHHHCCCCCCCCEEEEECCCCCCHHHHHHH
SRAGYRPLLEAGVRVFEWNGSMLHAKTAVADGRWARVGSSNLNMASWLGNWELDIAVENL
HHCCCCHHHHCCCEEEEECCCEEEEHHHHCCCCEEECCCCCCCHHHHCCCCEEEEEECCC
DFAQKMEQMYLEDLENSTEIVLNKKNRVRPIVDQLPHRPRRQYGVVRRRSGSASRLTAGA
HHHHHHHHHHHHHCCCCCEEEEECCCCCCHHHHHCCCCCCHHHHHHHCCCCCCHHHHHHH
LRVGNTVGAAITSRLVLGAAEAKIMFFGGVTLLALTVIALLEPLLMVIPFSLLAGWIGIS
HHHCCHHHHHHHHHHHHCCCCCEEEEECCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
LLIQAHRLHRNGQNDAAAQNASIASDEAQDKVIELPNSVREGQQPKDIRKEAQETQEIQK
HHHHHHHHHCCCCCCHHHCCCCCCCCHHHHHHHHCCHHHHCCCCCHHHHHHHHHHHHHHH
ALRQQ
HHHCC
>Mature Secondary Structure 
AKFKLTHLLREIPHETAREDASARIMAAQAFSRAAGAPLVHGNSIRLLKDASENYPAWL
CCHHHHHHHHHCCHHHHHCCHHHHHHHHHHHHHHCCCCEEECCCEEEEECCCCCCHHHH
DAIRSAEKNVYFENYIIRNDIIGQRFADALIAKAKEGIRVRLLYDWLGGLTETSSNFWRH
HHHHHHHCCEEEHHEEEHHHHHHHHHHHHHHHHHCCCCEEEEEEHHHCCHHHHHHHHHHH
LSNGGVEVRCFNPMRFDSPLAWLSRLHRKSVCVDDRVAFVSGLCVGQMWDGYPERNIAPW
HCCCCEEEEEECCCCCCCHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHCCCCCCCCCCCC
RDTGVELRGPVVADVINSFARAWAETGPEIPADELPAPDSIPIAGHIDVRVLGNFAATAG
CCCCCCCCCCHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCEECCEEEEEHHHHHHHHH
LYRLEQLITVLAQKTLWLTDAYFVGTTSYVQALRGAAMDNVDVRLLVPGSSGDLKFLRPI
HHHHHHHHHHHHHHHHHEECHHHHCCHHHHHHHHCCCCCCCCEEEEECCCCCCHHHHHHH
SRAGYRPLLEAGVRVFEWNGSMLHAKTAVADGRWARVGSSNLNMASWLGNWELDIAVENL
HHCCCCHHHHCCCEEEEECCCEEEEHHHHCCCCEEECCCCCCCHHHHCCCCEEEEEECCC
DFAQKMEQMYLEDLENSTEIVLNKKNRVRPIVDQLPHRPRRQYGVVRRRSGSASRLTAGA
HHHHHHHHHHHHHCCCCCEEEEECCCCCCHHHHHCCCCCCHHHHHHHCCCCCCHHHHHHH
LRVGNTVGAAITSRLVLGAAEAKIMFFGGVTLLALTVIALLEPLLMVIPFSLLAGWIGIS
HHHCCHHHHHHHHHHHHCCCCCEEEEECCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
LLIQAHRLHRNGQNDAAAQNASIASDEAQDKVIELPNSVREGQQPKDIRKEAQETQEIQK
HHHHHHHHHCCCCCCHHHCCCCCCCCHHHHHHHHCCHHHHCCCCCHHHHHHHHHHHHHHH
ALRQQ
HHHCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: CDPdiacylglycerol; sn-glycerol 3-phosphate

Specific reaction: CDP-diacylglycerol + sn-glycerol 3-phosphate = CMP + 3(3-sn-phosphatidyl)-sn-glycerol 1-phosphate

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 9443601 [H]