Definition Novosphingobium aromaticivorans DSM 12444 chromosome, complete genome.
Accession NC_007794
Length 3,561,584

Click here to switch to the map view.

The map label for this gene is yhdG [H]

Identifier: 87200058

GI number: 87200058

Start: 2179236

End: 2180813

Strand: Reverse

Name: yhdG [H]

Synonym: Saro_2042

Alternate gene names: 87200058

Gene position: 2180813-2179236 (Counterclockwise)

Preceding gene: 87200061

Following gene: 87200056

Centisome position: 61.23

GC content: 64.2

Gene sequence:

>1578_bases
ATGTTCGGTCGCGTCAAACCGCTCGACGCCATTCTTGCAACTGCAGAAAAGAAATCGTTGCACCGCTCGCTGGGTCCGGT
CCAGCTCACTCTTCTCGGTGTCGGTGCCATTATCGGTACCGGCATTTTCGTGCTTACGGCCGCCGCCGCGCAAAAGGCCG
GGCCGGGCATGATGTGGAGCTTCGTGATCGCGGGCTTCGTCTGCGCGGTTGCGGCTCTGTGCTATTCCGAGCTGGCCTCG
ATGGTCCCGGTCTCGGGTTCGGCCTATACCTACAGCTATGCCGTGGTCGGCGAAATGCTGGCCTGGATGGTCGGCTGGGC
ACTGATCCTCGAATATGCCGTGGCCGCGTCCGCCGTGTCGGTCGGGTGGTCCGGCTATTTCATGGGACTTCTCAAGAGTT
TGACCGGGTTTGAATTACCGGCGATGCTACAAGCTGGGCCAACCTGGACGATGAACGGCCTGCTGCCCCACGCTGATTTC
TCCACTGGCCTGATCAACGTGCCCGCAATCGTCGTGGCACTGCTCGTCACCTGGCTGCTCATGCTCGGCACCAAGGAAAG
CGCCACGTTCAACGCGATCCTCGTGGCGATCAAGGTCGCGGCGCTGACCATGTTCATCGTGCTGACCCTGCCGGCGATCG
AGCGCGAGCACTTCGCCCCATTCGCCCCCAACGGCTGGTTCGGCCCTGCCGGAACGACCGGGATGGGCATCGTCGGCGCG
GCGTCGTCGATCTTCTTTGCCTACGTCGGCTTCGACGCGGTCTCGACCGCTGCCGAAGAAACCAAGAACCCGCAGCGCAA
CGTGCCGATCGGCCTGATCGGAAGCCTTGCGATCTGCACCGTGTTCTACCTGCTGGTCGCCGCTGGCGCGATTGGTTCGA
TCGGTGCGCAGCCGACCGCTCTGGGCGTCGCGCCGGGTTCGGCCGAGTTCACCCAGCAGTGCGCCGCGCTGCTTGCTTCG
GGCCAGGAACCGCTGGTCTGCTCGAACGAGGCTCTGGCCCATGTCCTGCGCGCCATCAACTACACCTATGCTGGCGACCT
GATCGGCCTTGCGGCCAACCTCGCGCTGCCGTCGGTCATCCTGATGATGCTCTACGGCCAGACGCGCATCTTCTTCGTCA
TGGCGCGCGATGGCCTGCTTCCGGAGAAACTGGCCACCGTCCACCCCAAGTGGAAAACGCCTCACATCGTGACCGCAATG
ACCGGCGTATTCGTCGCCATCGCGGCGGCGCTGCTTCCGGTTGGTCAGCTTGCCGACATCTCAAATTCGGGCACGCTCTT
CGCGTTCTTCATGGTCGCGATCGCGGTCATGCTGCTCCGCGCCCGCGACCCGAACCGCGTCCGTCCGTTCCGCACACCGG
CGGTGTGGGTCGTCGGCCCGATCGCCGCGATTGGCTGTATCTTCCTCTACTGGAACCTGCCGTTCGAGGCGAAGATGGTC
CTTCCCGTCTGGGGCGCCATCGGGCTCGTGTTCTACTTCGCCTACGGCTATCGCAAGAGCCACGTCGGCCAGGGCCACGT
CGAAGTCCACGAGGGTGACGCCGACGTCCCGCCGATGCCGGTCCCGCCGATCGACTGA

Upstream 100 bases:

>100_bases
TGCGCGATGCCCGGTTCCCGCTAGCTTCGCGGCCATTACCTGGTTTCCGGAGCAACCGTATCGGCGGTTTCCTGCTCTGG
ACCAAGGCGGGGAGAATTTC

Downstream 100 bases:

>100_bases
TCGCAGCCGACTGCAAGGTCGGCAAGAAAGGGCCGCTCCTTCCCGGAGCGGCCCTTTTCGTTCGCTGGATCTGGACTGAC
CGCGCCAGGCGGGCGCTGCT

Product: phospholipid binding protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 525; Mature: 525

Protein sequence:

>525_residues
MFGRVKPLDAILATAEKKSLHRSLGPVQLTLLGVGAIIGTGIFVLTAAAAQKAGPGMMWSFVIAGFVCAVAALCYSELAS
MVPVSGSAYTYSYAVVGEMLAWMVGWALILEYAVAASAVSVGWSGYFMGLLKSLTGFELPAMLQAGPTWTMNGLLPHADF
STGLINVPAIVVALLVTWLLMLGTKESATFNAILVAIKVAALTMFIVLTLPAIEREHFAPFAPNGWFGPAGTTGMGIVGA
ASSIFFAYVGFDAVSTAAEETKNPQRNVPIGLIGSLAICTVFYLLVAAGAIGSIGAQPTALGVAPGSAEFTQQCAALLAS
GQEPLVCSNEALAHVLRAINYTYAGDLIGLAANLALPSVILMMLYGQTRIFFVMARDGLLPEKLATVHPKWKTPHIVTAM
TGVFVAIAAALLPVGQLADISNSGTLFAFFMVAIAVMLLRARDPNRVRPFRTPAVWVVGPIAAIGCIFLYWNLPFEAKMV
LPVWGAIGLVFYFAYGYRKSHVGQGHVEVHEGDADVPPMPVPPID

Sequences:

>Translated_525_residues
MFGRVKPLDAILATAEKKSLHRSLGPVQLTLLGVGAIIGTGIFVLTAAAAQKAGPGMMWSFVIAGFVCAVAALCYSELAS
MVPVSGSAYTYSYAVVGEMLAWMVGWALILEYAVAASAVSVGWSGYFMGLLKSLTGFELPAMLQAGPTWTMNGLLPHADF
STGLINVPAIVVALLVTWLLMLGTKESATFNAILVAIKVAALTMFIVLTLPAIEREHFAPFAPNGWFGPAGTTGMGIVGA
ASSIFFAYVGFDAVSTAAEETKNPQRNVPIGLIGSLAICTVFYLLVAAGAIGSIGAQPTALGVAPGSAEFTQQCAALLAS
GQEPLVCSNEALAHVLRAINYTYAGDLIGLAANLALPSVILMMLYGQTRIFFVMARDGLLPEKLATVHPKWKTPHIVTAM
TGVFVAIAAALLPVGQLADISNSGTLFAFFMVAIAVMLLRARDPNRVRPFRTPAVWVVGPIAAIGCIFLYWNLPFEAKMV
LPVWGAIGLVFYFAYGYRKSHVGQGHVEVHEGDADVPPMPVPPID
>Mature_525_residues
MFGRVKPLDAILATAEKKSLHRSLGPVQLTLLGVGAIIGTGIFVLTAAAAQKAGPGMMWSFVIAGFVCAVAALCYSELAS
MVPVSGSAYTYSYAVVGEMLAWMVGWALILEYAVAASAVSVGWSGYFMGLLKSLTGFELPAMLQAGPTWTMNGLLPHADF
STGLINVPAIVVALLVTWLLMLGTKESATFNAILVAIKVAALTMFIVLTLPAIEREHFAPFAPNGWFGPAGTTGMGIVGA
ASSIFFAYVGFDAVSTAAEETKNPQRNVPIGLIGSLAICTVFYLLVAAGAIGSIGAQPTALGVAPGSAEFTQQCAALLAS
GQEPLVCSNEALAHVLRAINYTYAGDLIGLAANLALPSVILMMLYGQTRIFFVMARDGLLPEKLATVHPKWKTPHIVTAM
TGVFVAIAAALLPVGQLADISNSGTLFAFFMVAIAVMLLRARDPNRVRPFRTPAVWVVGPIAAIGCIFLYWNLPFEAKMV
LPVWGAIGLVFYFAYGYRKSHVGQGHVEVHEGDADVPPMPVPPID

Specific function: Probable Amino-Acid Or Metabolite Transport Protein. [C]

COG id: COG0531

COG function: function code E; Amino acid transporters

Gene ontology:

Cell location: Cell membrane; Multi-pass membrane protein (Potential) [H]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the amino acid-polyamine-organocation (APC) superfamily [H]

Homologues:

Organism=Homo sapiens, GI258614003, Length=453, Percent_Identity=32.0088300220751, Blast_Score=183, Evalue=3e-46,
Organism=Homo sapiens, GI258614005, Length=453, Percent_Identity=32.0088300220751, Blast_Score=183, Evalue=3e-46,
Organism=Homo sapiens, GI4507047, Length=471, Percent_Identity=31.8471337579618, Blast_Score=182, Evalue=7e-46,
Organism=Homo sapiens, GI258645169, Length=453, Percent_Identity=32.4503311258278, Blast_Score=178, Evalue=1e-44,
Organism=Homo sapiens, GI181337167, Length=457, Percent_Identity=30.6345733041575, Blast_Score=171, Evalue=1e-42,
Organism=Homo sapiens, GI114326544, Length=457, Percent_Identity=29.1028446389497, Blast_Score=170, Evalue=4e-42,
Organism=Homo sapiens, GI114326550, Length=457, Percent_Identity=29.1028446389497, Blast_Score=170, Evalue=4e-42,
Organism=Homo sapiens, GI110347453, Length=441, Percent_Identity=31.0657596371882, Blast_Score=163, Evalue=4e-40,
Organism=Homo sapiens, GI115648063, Length=448, Percent_Identity=25, Blast_Score=94, Evalue=3e-19,
Organism=Homo sapiens, GI115648022, Length=448, Percent_Identity=25, Blast_Score=94, Evalue=3e-19,
Organism=Homo sapiens, GI33286428, Length=448, Percent_Identity=23.2142857142857, Blast_Score=86, Evalue=1e-16,
Organism=Escherichia coli, GI87081869, Length=521, Percent_Identity=22.4568138195777, Blast_Score=91, Evalue=1e-19,
Organism=Escherichia coli, GI87082023, Length=435, Percent_Identity=23.9080459770115, Blast_Score=77, Evalue=3e-15,
Organism=Escherichia coli, GI87082250, Length=446, Percent_Identity=24.6636771300448, Blast_Score=73, Evalue=5e-14,
Organism=Escherichia coli, GI1786302, Length=449, Percent_Identity=22.9398663697105, Blast_Score=70, Evalue=3e-13,
Organism=Escherichia coli, GI87081915, Length=387, Percent_Identity=25.0645994832041, Blast_Score=69, Evalue=7e-13,
Organism=Escherichia coli, GI1788480, Length=273, Percent_Identity=25.2747252747253, Blast_Score=66, Evalue=6e-12,
Organism=Caenorhabditis elegans, GI17532491, Length=446, Percent_Identity=32.7354260089686, Blast_Score=192, Evalue=4e-49,
Organism=Caenorhabditis elegans, GI17533459, Length=443, Percent_Identity=30.6997742663657, Blast_Score=162, Evalue=4e-40,
Organism=Caenorhabditis elegans, GI17531343, Length=507, Percent_Identity=26.4299802761341, Blast_Score=143, Evalue=2e-34,
Organism=Caenorhabditis elegans, GI17540018, Length=447, Percent_Identity=24.1610738255034, Blast_Score=80, Evalue=4e-15,
Organism=Caenorhabditis elegans, GI17537453, Length=400, Percent_Identity=22.75, Blast_Score=74, Evalue=2e-13,
Organism=Drosophila melanogaster, GI24667468, Length=441, Percent_Identity=31.0657596371882, Blast_Score=194, Evalue=2e-49,
Organism=Drosophila melanogaster, GI24666159, Length=451, Percent_Identity=30.5986696230599, Blast_Score=193, Evalue=2e-49,
Organism=Drosophila melanogaster, GI221512776, Length=451, Percent_Identity=30.5986696230599, Blast_Score=193, Evalue=2e-49,
Organism=Drosophila melanogaster, GI24668806, Length=440, Percent_Identity=31.1363636363636, Blast_Score=193, Evalue=3e-49,
Organism=Drosophila melanogaster, GI21356285, Length=440, Percent_Identity=31.1363636363636, Blast_Score=193, Evalue=3e-49,
Organism=Drosophila melanogaster, GI24668802, Length=440, Percent_Identity=31.1363636363636, Blast_Score=193, Evalue=3e-49,
Organism=Drosophila melanogaster, GI161077963, Length=446, Percent_Identity=28.9237668161435, Blast_Score=152, Evalue=5e-37,
Organism=Drosophila melanogaster, GI281366235, Length=456, Percent_Identity=29.6052631578947, Blast_Score=144, Evalue=2e-34,
Organism=Drosophila melanogaster, GI116007820, Length=456, Percent_Identity=29.6052631578947, Blast_Score=144, Evalue=2e-34,
Organism=Drosophila melanogaster, GI116007818, Length=456, Percent_Identity=29.6052631578947, Blast_Score=137, Evalue=1e-32,
Organism=Drosophila melanogaster, GI85725152, Length=456, Percent_Identity=29.6052631578947, Blast_Score=137, Evalue=1e-32,
Organism=Drosophila melanogaster, GI221331183, Length=480, Percent_Identity=22.9166666666667, Blast_Score=68, Evalue=1e-11,
Organism=Drosophila melanogaster, GI17647653, Length=480, Percent_Identity=22.9166666666667, Blast_Score=68, Evalue=1e-11,
Organism=Drosophila melanogaster, GI24664379, Length=480, Percent_Identity=22.9166666666667, Blast_Score=68, Evalue=1e-11,
Organism=Drosophila melanogaster, GI21357367, Length=511, Percent_Identity=22.7005870841487, Blast_Score=68, Evalue=1e-11,
Organism=Drosophila melanogaster, GI45550968, Length=509, Percent_Identity=22.2003929273084, Blast_Score=67, Evalue=3e-11,
Organism=Drosophila melanogaster, GI19921172, Length=509, Percent_Identity=22.2003929273084, Blast_Score=67, Evalue=3e-11,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR004841
- InterPro:   IPR002293
- InterPro:   IPR004758
- InterPro:   IPR015606 [H]

Pfam domain/function: PF00324 AA_permease [H]

EC number: NA

Molecular weight: Translated: 55255; Mature: 55255

Theoretical pI: Translated: 7.25; Mature: 7.25

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.1 %Cys     (Translated Protein)
3.8 %Met     (Translated Protein)
5.0 %Cys+Met (Translated Protein)
1.1 %Cys     (Mature Protein)
3.8 %Met     (Mature Protein)
5.0 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MFGRVKPLDAILATAEKKSLHRSLGPVQLTLLGVGAIIGTGIFVLTAAAAQKAGPGMMWS
CCCCCCHHHHHHHHHHHHHHHHCCCCEEEHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHH
FVIAGFVCAVAALCYSELASMVPVSGSAYTYSYAVVGEMLAWMVGWALILEYAVAASAVS
HHHHHHHHHHHHHHHHHHHHHCCCCCCCEEEHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
VGWSGYFMGLLKSLTGFELPAMLQAGPTWTMNGLLPHADFSTGLINVPAIVVALLVTWLL
HCHHHHHHHHHHHHCCCCCCHHHHCCCCEEECCCCCCCCCCCCCCHHHHHHHHHHHHHHH
MLGTKESATFNAILVAIKVAALTMFIVLTLPAIEREHFAPFAPNGWFGPAGTTGMGIVGA
HHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCHHHH
ASSIFFAYVGFDAVSTAAEETKNPQRNVPIGLIGSLAICTVFYLLVAAGAIGSIGAQPTA
HHHHHHHHHHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCE
LGVAPGSAEFTQQCAALLASGQEPLVCSNEALAHVLRAINYTYAGDLIGLAANLALPSVI
EECCCCCHHHHHHHHHHHHCCCCCEEECHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
LMMLYGQTRIFFVMARDGLLPEKLATVHPKWKTPHIVTAMTGVFVAIAAALLPVGQLADI
HHHHHCCCEEEEEEECCCCCHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHCCHHHHCC
SNSGTLFAFFMVAIAVMLLRARDPNRVRPFRTPAVWVVGPIAAIGCIFLYWNLPFEAKMV
CCCCHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHCCCCCCCEEH
LPVWGAIGLVFYFAYGYRKSHVGQGHVEVHEGDADVPPMPVPPID
HHHHHHHHHHHHHHHHHHHCCCCCCCEEEECCCCCCCCCCCCCCC
>Mature Secondary Structure
MFGRVKPLDAILATAEKKSLHRSLGPVQLTLLGVGAIIGTGIFVLTAAAAQKAGPGMMWS
CCCCCCHHHHHHHHHHHHHHHHCCCCEEEHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHH
FVIAGFVCAVAALCYSELASMVPVSGSAYTYSYAVVGEMLAWMVGWALILEYAVAASAVS
HHHHHHHHHHHHHHHHHHHHHCCCCCCCEEEHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
VGWSGYFMGLLKSLTGFELPAMLQAGPTWTMNGLLPHADFSTGLINVPAIVVALLVTWLL
HCHHHHHHHHHHHHCCCCCCHHHHCCCCEEECCCCCCCCCCCCCCHHHHHHHHHHHHHHH
MLGTKESATFNAILVAIKVAALTMFIVLTLPAIEREHFAPFAPNGWFGPAGTTGMGIVGA
HHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCHHHH
ASSIFFAYVGFDAVSTAAEETKNPQRNVPIGLIGSLAICTVFYLLVAAGAIGSIGAQPTA
HHHHHHHHHHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCE
LGVAPGSAEFTQQCAALLASGQEPLVCSNEALAHVLRAINYTYAGDLIGLAANLALPSVI
EECCCCCHHHHHHHHHHHHCCCCCEEECHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
LMMLYGQTRIFFVMARDGLLPEKLATVHPKWKTPHIVTAMTGVFVAIAAALLPVGQLADI
HHHHHCCCEEEEEEECCCCCHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHCCHHHHCC
SNSGTLFAFFMVAIAVMLLRARDPNRVRPFRTPAVWVVGPIAAIGCIFLYWNLPFEAKMV
CCCCHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHCCCCCCCEEH
LPVWGAIGLVFYFAYGYRKSHVGQGHVEVHEGDADVPPMPVPPID
HHHHHHHHHHHHHHHHHHHCCCCCCCEEEECCCCCCCCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 9579061; 9384377 [H]