Definition Sphingopyxis alaskensis RB2256, complete genome.
Accession NC_008048
Length 3,345,170

Click here to switch to the map view.

The map label for this gene is 103485691

Identifier: 103485691

GI number: 103485691

Start: 209034

End: 210590

Strand: Direct

Name: 103485691

Synonym: Sala_0195

Alternate gene names: NA

Gene position: 209034-210590 (Clockwise)

Preceding gene: 103485690

Following gene: 103485692

Centisome position: 6.25

GC content: 64.42

Gene sequence:

>1557_bases
ATGCTCAAACAGCTCAGCGCGCAGGACGCCCAGTTCCTCTACACCCAGACCGCGAACAACCTCACGCACATCATGGGCGT
CTATATCTATGATCCGTCGACCGCGCCGGGGGGCTTCGTGCGCTTCAAGGACATCATCGCCCATGTCGAAAGCCGCGTCG
ATACCTCGCCCCTGTTCAAGCGCCGCCTCCACCGCCTGCCGTTCGACATCGATCATCCCTATTGGGTCGAGGACGAGCAT
TTCGACGTCGAGGCCCACATGAGCCACGCGCGCCTGCCCGAACCGGGCGACTGGCGGCAATTCTGCATCGCGGTGGCGCG
CTGGTTCTCGAAGCCCATGGACATGAACCGCCCGCTCTGGGACATTTATGTGATCGAAGGGCTCGACCGCATCCCCGGTA
TTCCCAAGGGCAGCTTCGCGATGCTCCATCGCGTCCATCACGCCGCGGTCGACGGCGCTTCGGGCGCGCACGCCTTCATC
GCGATGAGCGATATCGACGCGAACGGCACGCCGGCGATCGCCGAACCGCCGCCGGTCGAGGATCTGGGCGATCCGCCGTC
GAGCGCCGAAATCCTTTCGCGCGCCTGGTCGGCGTCGATGCAATCGCCGGTAAAGTTCATGAACGCGCTGATGAAAATCT
CGCCGGCGATCGTCGCTTCGGCGCGCAGGTCGATCGCCGAGGGCGGGATGACCGCCGGGGTGCCCGAGACGCGCTTCAAC
GTCCCTGTCGGCCCGCACAAGATGTTCGACGGGACGACCGTGGCGCTCGCCGACGTCGCAGAGATCCGCAGAAAGGTTCC
GGGCGCGACGGTCAACGACGTCGTGCTCACGACGGTCGGCGGCGCGCTGCGCAAATATCTGGCGAAGCATAAGGAATTGC
CGAAGGAAAGCCTCGTCGCGGTCGCGCCGGTCAATCTGCGCGGCAAGGGCGGAAAGGCGTCGACGCCGGGCAATCAGGTG
TCGGCGATGAGCGTGCCGATCCGCACCGACATCGCCGATCCGCTCGAACGGCTCGCCGCGGTGCGCGACTATACGGTCGA
GGCCAAGGAGGCCAAAGCCGGCGTGAGCGCGCGGATCATGACCGACCTGTCACAGCATATCCCCGGCGCCACGATGGCGG
CGGTCGCGCGGCTCGTCACCAGCGAGCGCTTTGCGGTGCGCGGCACCAATCTCTTCATCTCGAACGTCCCCGGCGCGCAG
GTGCCGCTCTACCTCGCGGGCGCCAGGCTGGTGCAGCAGCACGGCATGGCGCCGCTCGCGAACAATATGGGGCTGTTCAT
AGCGACCCCCAGCTACAATGGCCGCATCGCCTTCTCGATCATTTCGGAACGTGCGATCATGCCCGACATCGCTTTCTTTC
GAACATGTATCGACGAAAGTTTCGCCGATTTGATGGCGGCGGATCCGAAACCTGAAAAGCCAAAAGCCGCTACGGCAAAG
CCGAAAGCGGCGGCAAAGCCCAAAGCGAAAGCGACGGCCAAAGCGGACAGGAAAAACACCTCTTCGTCATCCCGGCGAAG
GCCGGGATCTCGCCCTCGCGTTAAATCTCCACGGTGA

Upstream 100 bases:

>100_bases
GATGGGGGCGGGGGAATGAATATCGCGTATCGCTCCCGCCATTCCGGCGACGGCCGGATCGTCCCCCGCTGGGGGAGGAT
TTTCAAGTCAGGAACCTAAC

Downstream 100 bases:

>100_bases
GATCCCGGCCTTCGCCGGGATGACGAGTGTATGGCAAGCATCGTCAAAACAGTTGCCAAAGACAACGTAAGCCCGCAAGA
ATCGAGAAAAACATACCATG

Product: hypothetical protein

Products: NA

Alternate protein names: Putative triacylglycerol synthase Rv1425/MT1468 [H]

Number of amino acids: Translated: 518; Mature: 518

Protein sequence:

>518_residues
MLKQLSAQDAQFLYTQTANNLTHIMGVYIYDPSTAPGGFVRFKDIIAHVESRVDTSPLFKRRLHRLPFDIDHPYWVEDEH
FDVEAHMSHARLPEPGDWRQFCIAVARWFSKPMDMNRPLWDIYVIEGLDRIPGIPKGSFAMLHRVHHAAVDGASGAHAFI
AMSDIDANGTPAIAEPPPVEDLGDPPSSAEILSRAWSASMQSPVKFMNALMKISPAIVASARRSIAEGGMTAGVPETRFN
VPVGPHKMFDGTTVALADVAEIRRKVPGATVNDVVLTTVGGALRKYLAKHKELPKESLVAVAPVNLRGKGGKASTPGNQV
SAMSVPIRTDIADPLERLAAVRDYTVEAKEAKAGVSARIMTDLSQHIPGATMAAVARLVTSERFAVRGTNLFISNVPGAQ
VPLYLAGARLVQQHGMAPLANNMGLFIATPSYNGRIAFSIISERAIMPDIAFFRTCIDESFADLMAADPKPEKPKAATAK
PKAAAKPKAKATAKADRKNTSSSSRRRPGSRPRVKSPR

Sequences:

>Translated_518_residues
MLKQLSAQDAQFLYTQTANNLTHIMGVYIYDPSTAPGGFVRFKDIIAHVESRVDTSPLFKRRLHRLPFDIDHPYWVEDEH
FDVEAHMSHARLPEPGDWRQFCIAVARWFSKPMDMNRPLWDIYVIEGLDRIPGIPKGSFAMLHRVHHAAVDGASGAHAFI
AMSDIDANGTPAIAEPPPVEDLGDPPSSAEILSRAWSASMQSPVKFMNALMKISPAIVASARRSIAEGGMTAGVPETRFN
VPVGPHKMFDGTTVALADVAEIRRKVPGATVNDVVLTTVGGALRKYLAKHKELPKESLVAVAPVNLRGKGGKASTPGNQV
SAMSVPIRTDIADPLERLAAVRDYTVEAKEAKAGVSARIMTDLSQHIPGATMAAVARLVTSERFAVRGTNLFISNVPGAQ
VPLYLAGARLVQQHGMAPLANNMGLFIATPSYNGRIAFSIISERAIMPDIAFFRTCIDESFADLMAADPKPEKPKAATAK
PKAAAKPKAKATAKADRKNTSSSSRRRPGSRPRVKSPR
>Mature_518_residues
MLKQLSAQDAQFLYTQTANNLTHIMGVYIYDPSTAPGGFVRFKDIIAHVESRVDTSPLFKRRLHRLPFDIDHPYWVEDEH
FDVEAHMSHARLPEPGDWRQFCIAVARWFSKPMDMNRPLWDIYVIEGLDRIPGIPKGSFAMLHRVHHAAVDGASGAHAFI
AMSDIDANGTPAIAEPPPVEDLGDPPSSAEILSRAWSASMQSPVKFMNALMKISPAIVASARRSIAEGGMTAGVPETRFN
VPVGPHKMFDGTTVALADVAEIRRKVPGATVNDVVLTTVGGALRKYLAKHKELPKESLVAVAPVNLRGKGGKASTPGNQV
SAMSVPIRTDIADPLERLAAVRDYTVEAKEAKAGVSARIMTDLSQHIPGATMAAVARLVTSERFAVRGTNLFISNVPGAQ
VPLYLAGARLVQQHGMAPLANNMGLFIATPSYNGRIAFSIISERAIMPDIAFFRTCIDESFADLMAADPKPEKPKAATAK
PKAAAKPKAKATAKADRKNTSSSSRRRPGSRPRVKSPR

Specific function: Upon expression in E.coli functions very weakly as a triacylglycerol synthase, making triacylglycerol (TG) from diolein and long-chain fatty acyl-CoA. Has no wax synthase activity [H]

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Belongs to the long-chain O-acyltransferase family [H]

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR014292
- InterPro:   IPR004255 [H]

Pfam domain/function: PF03007 UPF0089 [H]

EC number: =2.3.1.20 [H]

Molecular weight: Translated: 56123; Mature: 56123

Theoretical pI: Translated: 10.28; Mature: 10.28

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.4 %Cys     (Translated Protein)
3.7 %Met     (Translated Protein)
4.1 %Cys+Met (Translated Protein)
0.4 %Cys     (Mature Protein)
3.7 %Met     (Mature Protein)
4.1 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MLKQLSAQDAQFLYTQTANNLTHIMGVYIYDPSTAPGGFVRFKDIIAHVESRVDTSPLFK
CCCCCCCCCHHEEEHHHHCCCEEEEEEEEECCCCCCCCHHHHHHHHHHHHHHCCCCHHHH
RRLHRLPFDIDHPYWVEDEHFDVEAHMSHARLPEPGDWRQFCIAVARWFSKPMDMNRPLW
HHHHHCCCCCCCCEECCCCCCCHHHHHHHCCCCCCCCHHHHHHHHHHHHCCCCCCCCCEE
DIYVIEGLDRIPGIPKGSFAMLHRVHHAAVDGASGAHAFIAMSDIDANGTPAIAEPPPVE
EEEEECCHHHCCCCCCCHHHHHHHHHHHHCCCCCCCEEEEEEEECCCCCCCCCCCCCCCH
DLGDPPSSAEILSRAWSASMQSPVKFMNALMKISPAIVASARRSIAEGGMTAGVPETRFN
HCCCCCCHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCC
VPVGPHKMFDGTTVALADVAEIRRKVPGATVNDVVLTTVGGALRKYLAKHKELPKESLVA
CCCCCCCCCCCCHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHCCCHHHEEE
VAPVNLRGKGGKASTPGNQVSAMSVPIRTDIADPLERLAAVRDYTVEAKEAKAGVSARIM
EECEEECCCCCCCCCCCCCEEEEECCHHHHHHHHHHHHHHHHHCCCCHHHHHCCCHHHHH
TDLSQHIPGATMAAVARLVTSERFAVRGTNLFISNVPGAQVPLYLAGARLVQQHGMAPLA
HHHHHHCCCHHHHHHHHHHHCCCEEEECCEEEEECCCCCCCHHHHHHHHHHHHCCCCCCC
NNMGLFIATPSYNGRIAFSIISERAIMPDIAFFRTCIDESFADLMAADPKPEKPKAATAK
CCCEEEEECCCCCCEEEEEEECCCCCCCHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCC
PKAAAKPKAKATAKADRKNTSSSSRRRPGSRPRVKSPR
CCCCCCCCHHHHHHHHCCCCCCHHHCCCCCCCCCCCCC
>Mature Secondary Structure
MLKQLSAQDAQFLYTQTANNLTHIMGVYIYDPSTAPGGFVRFKDIIAHVESRVDTSPLFK
CCCCCCCCCHHEEEHHHHCCCEEEEEEEEECCCCCCCCHHHHHHHHHHHHHHCCCCHHHH
RRLHRLPFDIDHPYWVEDEHFDVEAHMSHARLPEPGDWRQFCIAVARWFSKPMDMNRPLW
HHHHHCCCCCCCCEECCCCCCCHHHHHHHCCCCCCCCHHHHHHHHHHHHCCCCCCCCCEE
DIYVIEGLDRIPGIPKGSFAMLHRVHHAAVDGASGAHAFIAMSDIDANGTPAIAEPPPVE
EEEEECCHHHCCCCCCCHHHHHHHHHHHHCCCCCCCEEEEEEEECCCCCCCCCCCCCCCH
DLGDPPSSAEILSRAWSASMQSPVKFMNALMKISPAIVASARRSIAEGGMTAGVPETRFN
HCCCCCCHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCC
VPVGPHKMFDGTTVALADVAEIRRKVPGATVNDVVLTTVGGALRKYLAKHKELPKESLVA
CCCCCCCCCCCCHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHCCCHHHEEE
VAPVNLRGKGGKASTPGNQVSAMSVPIRTDIADPLERLAAVRDYTVEAKEAKAGVSARIM
EECEEECCCCCCCCCCCCCEEEEECCHHHHHHHHHHHHHHHHHCCCCHHHHHCCCHHHHH
TDLSQHIPGATMAAVARLVTSERFAVRGTNLFISNVPGAQVPLYLAGARLVQQHGMAPLA
HHHHHHCCCHHHHHHHHHHHCCCEEEECCEEEEECCCCCCCHHHHHHHHHHHHCCCCCCC
NNMGLFIATPSYNGRIAFSIISERAIMPDIAFFRTCIDESFADLMAADPKPEKPKAATAK
CCCEEEEECCCCCCEEEEEEECCCCCCCHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCC
PKAAAKPKAKATAKADRKNTSSSSRRRPGSRPRVKSPR
CCCCCCCCHHHHHHHHCCCCCCHHHCCCCCCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 9634230; 12218036 [H]