Definition Novosphingobium aromaticivorans DSM 12444 chromosome, complete genome.
Accession NC_007794
Length 3,561,584

Click here to switch to the map view.

The map label for this gene is yrhL [H]

Identifier: 87199331

GI number: 87199331

Start: 1353867

End: 1355732

Strand: Reverse

Name: yrhL [H]

Synonym: Saro_1310

Alternate gene names: 87199331

Gene position: 1355732-1353867 (Counterclockwise)

Preceding gene: 87199332

Following gene: 87199330

Centisome position: 38.07

GC content: 69.88

Gene sequence:

>1866_bases
TTGCAACATCGTCGCGAAATCGAAGGACTGCGCGCCGTTGCCGTGATCCCGGTGGTTCTCTTCCACGCGGGCGTGGGCGG
GCTCTCGGGCGGCTTCGCCGGGGTCGATGTGTTCTTCGTGATCAGCGGCTACCTGATCGCTTCGACGATCCTCGACCAGA
CGGCGCAAGGCCGCTTCTCGCTTCGCCAGTTCTACGAAAGACGCGCCCGGCGCATCCTTCCCGCGCTCCTGCCGGTCCTC
GCGGCAAGCGCGGTTCTGGCGTGGCTGCTGCTCGTCCCCGAGGACTTCCGCAAGTTCGCGCAGGCCCTGGGCGCCACCGC
CACCTTCGGCGCCAATTTCCTGTTCGCCCGGCGCACCGGCTATTTCGACGACGACGAAGGCTTCCGTCCACTGCTGCACA
TGTGGAGCCTGTCGGTGGAGGAACAGTTCTACCTGCTGTTCCCCCTGCTCATGCTGGCATTGCGGCACATCGGGCGCGCT
CGCCTGGCCTTGGCCCTCGCAGGGCTGGGCTTGCTGTCGTTCACGCTGATGCAGGCGCTGCGCCCGATCGACCCTGCGCT
GTCCTTCTACATGCTGCCCACCCGCGCGTGGGAGCTTCTGGCGGGCGCGACCTGCGCCGCCCTGCCCTTGCCCGCCCGGC
AGGATGGACGCCTTGCCACCGCCGGACTTGCGCTCGTCGCCGCAGGGTTCGTCGCCGCAAGCCCCGCCTCAGCGCCGGAC
TGGACGCTGCTCCTTCCGGTTATCGGCACCGCGCTCATCCTGCTGCACGCGGGGCCGGCGAACCTCGCCGGCCGGGCGCT
CGCATGGCGCCCGCTCACCGCCATCGGCGCGGCGTCCTATGGCATATACCTTTGGCACGCCCCGCTGCTCGCGTTCCTGC
GCTACGCATGGCTGGGCGAGCCGCCGCCGCTACTTCTTTCGGGAGCCATCGCGCTGGCCTTTGCACTTGGCTTCGCGTCA
CTGCGCCTGATCGAGATGCCCGTCCGCCAGAGCTTGGCCCTGCGCCGTCCCTCGCACCTGGCCATGGTCTGCGCGGGCGG
CCTGGCCCTTGCCCTCGCGGCAGGCGCGGCAGGCCATTTCGGCCGCCTCGAACCCCGAAGCGCGACCCTGCGCAACAAGC
TGGGCGGCGCGCCGTCCGCCCTCCCCTATCCCGCCAGCAGCATTCCGTCGCCCGGCAGGCCGGTTCCTTACATCCTCTAT
GGCGACAGCCACGCGCGCCAGTATTCCAGCGCCCTGCGCGAAGCTTTCGGCGAAGGCGCGATGCTCACCGCCTCGGGCTG
CCTCGCCCTTCCCGGCATGAGCAACATGGCCGTCGCCGCCGAGGAGGCGAAGGAATGCGAAGCCCTGCCGGCCGAACTCG
CCCGCCTTGTCGCCCGGCGCGGAATAGGCACTGTGGTTTGGGCACAACGCTGGGACCGAAACCTGTTCTCGTCGGGCTCA
CACCTCCCCCTCGGTCGCACTTCCGCCGAGGGGCGCGCGGCTTTCCTCGCCGGGCTGGATCGGCTGCGCGGCGCATTGCC
GCCCGGCACCCGCATGGTCCTTGTCGGCAACGTCCCCACCGCCGCACCCGCAGGTCCGGGCATGGCGGGCGGCTACCTGC
GCTGCCGCGCATACGTCAACGCGACGTGCCCCACCTCGTATCCGCGCGCGCTTGCCGAAGGCCATGCGATCAACCCGGTG
CTGGCCGCCTATGCCGAGCGTCATGCGGACGTCACCTTCTTCGACCCGGCCAGCGCCCTGTGCCACGGCGGTGCGTGCGA
TATTCTTGTCGGCGGCGACCTCCTCTATTCCGACCACACCCATCTTACGGTGGGCGGCTCGCGCCGCGTGGTCGGCCGCA
TGAAGCAGGTGCTTCCGGCGCTCTGA

Upstream 100 bases:

>100_bases
TTCGCCTACCCGGAACGTCACGCTGCGGCGGCCGTGGGCGATTGCCTGCGACTGCACGATCAGCCATGGTCGGGACGGGA
CAATCGGGGCCGGGTACTTC

Downstream 100 bases:

>100_bases
CCACTTGCGCAACGTTCATTCGGACCTGCCTTTTCCTGAACGGCATGGCCTCGCCCCTTGCGTTTGAGCGGCCTAACCCC
TAGCGGCCCGGGCAAGATTT

Product: acyltransferase 3

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 621; Mature: 621

Protein sequence:

>621_residues
MQHRREIEGLRAVAVIPVVLFHAGVGGLSGGFAGVDVFFVISGYLIASTILDQTAQGRFSLRQFYERRARRILPALLPVL
AASAVLAWLLLVPEDFRKFAQALGATATFGANFLFARRTGYFDDDEGFRPLLHMWSLSVEEQFYLLFPLLMLALRHIGRA
RLALALAGLGLLSFTLMQALRPIDPALSFYMLPTRAWELLAGATCAALPLPARQDGRLATAGLALVAAGFVAASPASAPD
WTLLLPVIGTALILLHAGPANLAGRALAWRPLTAIGAASYGIYLWHAPLLAFLRYAWLGEPPPLLLSGAIALAFALGFAS
LRLIEMPVRQSLALRRPSHLAMVCAGGLALALAAGAAGHFGRLEPRSATLRNKLGGAPSALPYPASSIPSPGRPVPYILY
GDSHARQYSSALREAFGEGAMLTASGCLALPGMSNMAVAAEEAKECEALPAELARLVARRGIGTVVWAQRWDRNLFSSGS
HLPLGRTSAEGRAAFLAGLDRLRGALPPGTRMVLVGNVPTAAPAGPGMAGGYLRCRAYVNATCPTSYPRALAEGHAINPV
LAAYAERHADVTFFDPASALCHGGACDILVGGDLLYSDHTHLTVGGSRRVVGRMKQVLPAL

Sequences:

>Translated_621_residues
MQHRREIEGLRAVAVIPVVLFHAGVGGLSGGFAGVDVFFVISGYLIASTILDQTAQGRFSLRQFYERRARRILPALLPVL
AASAVLAWLLLVPEDFRKFAQALGATATFGANFLFARRTGYFDDDEGFRPLLHMWSLSVEEQFYLLFPLLMLALRHIGRA
RLALALAGLGLLSFTLMQALRPIDPALSFYMLPTRAWELLAGATCAALPLPARQDGRLATAGLALVAAGFVAASPASAPD
WTLLLPVIGTALILLHAGPANLAGRALAWRPLTAIGAASYGIYLWHAPLLAFLRYAWLGEPPPLLLSGAIALAFALGFAS
LRLIEMPVRQSLALRRPSHLAMVCAGGLALALAAGAAGHFGRLEPRSATLRNKLGGAPSALPYPASSIPSPGRPVPYILY
GDSHARQYSSALREAFGEGAMLTASGCLALPGMSNMAVAAEEAKECEALPAELARLVARRGIGTVVWAQRWDRNLFSSGS
HLPLGRTSAEGRAAFLAGLDRLRGALPPGTRMVLVGNVPTAAPAGPGMAGGYLRCRAYVNATCPTSYPRALAEGHAINPV
LAAYAERHADVTFFDPASALCHGGACDILVGGDLLYSDHTHLTVGGSRRVVGRMKQVLPAL
>Mature_621_residues
MQHRREIEGLRAVAVIPVVLFHAGVGGLSGGFAGVDVFFVISGYLIASTILDQTAQGRFSLRQFYERRARRILPALLPVL
AASAVLAWLLLVPEDFRKFAQALGATATFGANFLFARRTGYFDDDEGFRPLLHMWSLSVEEQFYLLFPLLMLALRHIGRA
RLALALAGLGLLSFTLMQALRPIDPALSFYMLPTRAWELLAGATCAALPLPARQDGRLATAGLALVAAGFVAASPASAPD
WTLLLPVIGTALILLHAGPANLAGRALAWRPLTAIGAASYGIYLWHAPLLAFLRYAWLGEPPPLLLSGAIALAFALGFAS
LRLIEMPVRQSLALRRPSHLAMVCAGGLALALAAGAAGHFGRLEPRSATLRNKLGGAPSALPYPASSIPSPGRPVPYILY
GDSHARQYSSALREAFGEGAMLTASGCLALPGMSNMAVAAEEAKECEALPAELARLVARRGIGTVVWAQRWDRNLFSSGS
HLPLGRTSAEGRAAFLAGLDRLRGALPPGTRMVLVGNVPTAAPAGPGMAGGYLRCRAYVNATCPTSYPRALAEGHAINPV
LAAYAERHADVTFFDPASALCHGGACDILVGGDLLYSDHTHLTVGGSRRVVGRMKQVLPAL

Specific function: Unknown

COG id: COG1835

COG function: function code I; Predicted acyltransferases

Gene ontology:

Cell location: Cell membrane; Multi-pass membrane protein [H]

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Belongs to the acyltransferase 3 family [H]

Homologues:

Organism=Caenorhabditis elegans, GI71990417, Length=320, Percent_Identity=29.6875, Blast_Score=112, Evalue=4e-25,
Organism=Caenorhabditis elegans, GI86562056, Length=317, Percent_Identity=29.0220820189274, Blast_Score=107, Evalue=2e-23,
Organism=Caenorhabditis elegans, GI17560876, Length=360, Percent_Identity=26.1111111111111, Blast_Score=105, Evalue=5e-23,
Organism=Caenorhabditis elegans, GI212646204, Length=320, Percent_Identity=29.6875, Blast_Score=100, Evalue=4e-21,
Organism=Caenorhabditis elegans, GI17559158, Length=299, Percent_Identity=29.4314381270903, Blast_Score=98, Evalue=1e-20,
Organism=Caenorhabditis elegans, GI17559544, Length=319, Percent_Identity=28.8401253918495, Blast_Score=97, Evalue=2e-20,
Organism=Caenorhabditis elegans, GI17562856, Length=318, Percent_Identity=27.9874213836478, Blast_Score=97, Evalue=3e-20,
Organism=Caenorhabditis elegans, GI17562864, Length=318, Percent_Identity=27.6729559748428, Blast_Score=96, Evalue=5e-20,
Organism=Caenorhabditis elegans, GI17562866, Length=325, Percent_Identity=30.1538461538462, Blast_Score=95, Evalue=1e-19,
Organism=Caenorhabditis elegans, GI212640769, Length=325, Percent_Identity=27.0769230769231, Blast_Score=95, Evalue=1e-19,
Organism=Caenorhabditis elegans, GI32567150, Length=222, Percent_Identity=29.2792792792793, Blast_Score=93, Evalue=4e-19,
Organism=Caenorhabditis elegans, GI71984481, Length=207, Percent_Identity=31.4009661835749, Blast_Score=92, Evalue=8e-19,
Organism=Caenorhabditis elegans, GI17543924, Length=312, Percent_Identity=27.2435897435897, Blast_Score=92, Evalue=8e-19,
Organism=Caenorhabditis elegans, GI17507733, Length=327, Percent_Identity=27.217125382263, Blast_Score=90, Evalue=4e-18,
Organism=Caenorhabditis elegans, GI17507735, Length=361, Percent_Identity=26.5927977839335, Blast_Score=90, Evalue=4e-18,
Organism=Caenorhabditis elegans, GI133903927, Length=330, Percent_Identity=25.1515151515152, Blast_Score=89, Evalue=5e-18,
Organism=Caenorhabditis elegans, GI17541414, Length=356, Percent_Identity=25, Blast_Score=88, Evalue=1e-17,
Organism=Caenorhabditis elegans, GI17507283, Length=360, Percent_Identity=26.1111111111111, Blast_Score=87, Evalue=2e-17,
Organism=Caenorhabditis elegans, GI193208811, Length=342, Percent_Identity=24.5614035087719, Blast_Score=86, Evalue=5e-17,
Organism=Caenorhabditis elegans, GI212642133, Length=308, Percent_Identity=28.8961038961039, Blast_Score=85, Evalue=1e-16,
Organism=Caenorhabditis elegans, GI17542538, Length=334, Percent_Identity=28.1437125748503, Blast_Score=84, Evalue=2e-16,
Organism=Caenorhabditis elegans, GI17532481, Length=334, Percent_Identity=27.8443113772455, Blast_Score=83, Evalue=4e-16,
Organism=Caenorhabditis elegans, GI17507287, Length=338, Percent_Identity=25.4437869822485, Blast_Score=82, Evalue=6e-16,
Organism=Caenorhabditis elegans, GI17509001, Length=351, Percent_Identity=27.3504273504274, Blast_Score=82, Evalue=8e-16,
Organism=Caenorhabditis elegans, GI193203181, Length=335, Percent_Identity=26.2686567164179, Blast_Score=82, Evalue=8e-16,
Organism=Caenorhabditis elegans, GI193203179, Length=340, Percent_Identity=26.7647058823529, Blast_Score=82, Evalue=9e-16,
Organism=Caenorhabditis elegans, GI17507167, Length=325, Percent_Identity=27.6923076923077, Blast_Score=82, Evalue=1e-15,
Organism=Caenorhabditis elegans, GI71982248, Length=578, Percent_Identity=22.8373702422145, Blast_Score=82, Evalue=1e-15,
Organism=Caenorhabditis elegans, GI17541412, Length=365, Percent_Identity=25.4794520547945, Blast_Score=81, Evalue=1e-15,
Organism=Caenorhabditis elegans, GI17507299, Length=339, Percent_Identity=25.6637168141593, Blast_Score=79, Evalue=1e-14,
Organism=Caenorhabditis elegans, GI17507289, Length=339, Percent_Identity=25.6637168141593, Blast_Score=79, Evalue=1e-14,
Organism=Caenorhabditis elegans, GI17541016, Length=326, Percent_Identity=26.3803680981595, Blast_Score=75, Evalue=1e-13,
Organism=Caenorhabditis elegans, GI17541014, Length=326, Percent_Identity=26.3803680981595, Blast_Score=75, Evalue=1e-13,
Organism=Caenorhabditis elegans, GI17506687, Length=318, Percent_Identity=27.3584905660377, Blast_Score=73, Evalue=5e-13,
Organism=Caenorhabditis elegans, GI17539118, Length=380, Percent_Identity=23.9473684210526, Blast_Score=72, Evalue=6e-13,
Organism=Caenorhabditis elegans, GI71983744, Length=329, Percent_Identity=25.531914893617, Blast_Score=66, Evalue=7e-11,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR002656
- InterPro:   IPR013830
- InterPro:   IPR013831 [H]

Pfam domain/function: PF01757 Acyl_transf_3 [H]

EC number: NA

Molecular weight: Translated: 65700; Mature: 65700

Theoretical pI: Translated: 9.92; Mature: 9.92

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.3 %Cys     (Translated Protein)
2.1 %Met     (Translated Protein)
3.4 %Cys+Met (Translated Protein)
1.3 %Cys     (Mature Protein)
2.1 %Met     (Mature Protein)
3.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MQHRREIEGLRAVAVIPVVLFHAGVGGLSGGFAGVDVFFVISGYLIASTILDQTAQGRFS
CCCHHHHHHHHHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCHHH
LRQFYERRARRILPALLPVLAASAVLAWLLLVPEDFRKFAQALGATATFGANFLFARRTG
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHCCCHHCCCCEEEEECCC
YFDDDEGFRPLLHMWSLSVEEQFYLLFPLLMLALRHIGRARLALALAGLGLLSFTLMQAL
CCCCCCCHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
RPIDPALSFYMLPTRAWELLAGATCAALPLPARQDGRLATAGLALVAAGFVAASPASAPD
CCCCHHHHHEECHHHHHHHHHCCHHHHCCCCCCCCCCCHHHHHHHHHHHHHHCCCCCCCC
WTLLLPVIGTALILLHAGPANLAGRALAWRPLTAIGAASYGIYLWHAPLLAFLRYAWLGE
CEEHHHHHHHHHHHHCCCCCCCCCCCEECCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCC
PPPLLLSGAIALAFALGFASLRLIEMPVRQSLALRRPSHLAMVCAGGLALALAAGAAGHF
CCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHCCCCCC
GRLEPRSATLRNKLGGAPSALPYPASSIPSPGRPVPYILYGDSHARQYSSALREAFGEGA
CCCCCCHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCEEEECCHHHHHHHHHHHHHHCCCC
MLTASGCLALPGMSNMAVAAEEAKECEALPAELARLVARRGIGTVVWAQRWDRNLFSSGS
EEEECCCEECCCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHCHHHHCCCC
HLPLGRTSAEGRAAFLAGLDRLRGALPPGTRMVLVGNVPTAAPAGPGMAGGYLRCRAYVN
CCCCCCCCCCCHHHHHHHHHHHHCCCCCCCEEEEEECCCCCCCCCCCCCCCCEEEEEEEC
ATCPTSYPRALAEGHAINPVLAAYAERHADVTFFDPASALCHGGACDILVGGDLLYSDHT
CCCCCCHHHHHHCCCCCCHHHHHHHHHCCCEEEECCHHHHHCCCCEEEEECCEEEECCCC
HLTVGGSRRVVGRMKQVLPAL
EEEECCCHHHHHHHHHHHCCC
>Mature Secondary Structure
MQHRREIEGLRAVAVIPVVLFHAGVGGLSGGFAGVDVFFVISGYLIASTILDQTAQGRFS
CCCHHHHHHHHHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCHHH
LRQFYERRARRILPALLPVLAASAVLAWLLLVPEDFRKFAQALGATATFGANFLFARRTG
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHCCCHHCCCCEEEEECCC
YFDDDEGFRPLLHMWSLSVEEQFYLLFPLLMLALRHIGRARLALALAGLGLLSFTLMQAL
CCCCCCCHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
RPIDPALSFYMLPTRAWELLAGATCAALPLPARQDGRLATAGLALVAAGFVAASPASAPD
CCCCHHHHHEECHHHHHHHHHCCHHHHCCCCCCCCCCCHHHHHHHHHHHHHHCCCCCCCC
WTLLLPVIGTALILLHAGPANLAGRALAWRPLTAIGAASYGIYLWHAPLLAFLRYAWLGE
CEEHHHHHHHHHHHHCCCCCCCCCCCEECCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCC
PPPLLLSGAIALAFALGFASLRLIEMPVRQSLALRRPSHLAMVCAGGLALALAAGAAGHF
CCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHCCCCCC
GRLEPRSATLRNKLGGAPSALPYPASSIPSPGRPVPYILYGDSHARQYSSALREAFGEGA
CCCCCCHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCEEEECCHHHHHHHHHHHHHHCCCC
MLTASGCLALPGMSNMAVAAEEAKECEALPAELARLVARRGIGTVVWAQRWDRNLFSSGS
EEEECCCEECCCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHCHHHHCCCC
HLPLGRTSAEGRAAFLAGLDRLRGALPPGTRMVLVGNVPTAAPAGPGMAGGYLRCRAYVN
CCCCCCCCCCCHHHHHHHHHHHHCCCCCCCEEEEEECCCCCCCCCCCCCCCCEEEEEEEC
ATCPTSYPRALAEGHAINPVLAAYAERHADVTFFDPASALCHGGACDILVGGDLLYSDHT
CCCCCCHHHHHHCCCCCCHHHHHHHHHCCCEEEECCHHHHHCCCCEEEEECCEEEECCCC
HLTVGGSRRVVGRMKQVLPAL
EEEECCCHHHHHHHHHHHCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 9308178; 9384377 [H]