| Definition | Novosphingobium aromaticivorans DSM 12444 chromosome, complete genome. |
|---|---|
| Accession | NC_007794 |
| Length | 3,561,584 |
Click here to switch to the map view.
The map label for this gene is yhdG [H]
Identifier: 87200058
GI number: 87200058
Start: 2179236
End: 2180813
Strand: Reverse
Name: yhdG [H]
Synonym: Saro_2042
Alternate gene names: 87200058
Gene position: 2180813-2179236 (Counterclockwise)
Preceding gene: 87200061
Following gene: 87200056
Centisome position: 61.23
GC content: 64.2
Gene sequence:
>1578_bases ATGTTCGGTCGCGTCAAACCGCTCGACGCCATTCTTGCAACTGCAGAAAAGAAATCGTTGCACCGCTCGCTGGGTCCGGT CCAGCTCACTCTTCTCGGTGTCGGTGCCATTATCGGTACCGGCATTTTCGTGCTTACGGCCGCCGCCGCGCAAAAGGCCG GGCCGGGCATGATGTGGAGCTTCGTGATCGCGGGCTTCGTCTGCGCGGTTGCGGCTCTGTGCTATTCCGAGCTGGCCTCG ATGGTCCCGGTCTCGGGTTCGGCCTATACCTACAGCTATGCCGTGGTCGGCGAAATGCTGGCCTGGATGGTCGGCTGGGC ACTGATCCTCGAATATGCCGTGGCCGCGTCCGCCGTGTCGGTCGGGTGGTCCGGCTATTTCATGGGACTTCTCAAGAGTT TGACCGGGTTTGAATTACCGGCGATGCTACAAGCTGGGCCAACCTGGACGATGAACGGCCTGCTGCCCCACGCTGATTTC TCCACTGGCCTGATCAACGTGCCCGCAATCGTCGTGGCACTGCTCGTCACCTGGCTGCTCATGCTCGGCACCAAGGAAAG CGCCACGTTCAACGCGATCCTCGTGGCGATCAAGGTCGCGGCGCTGACCATGTTCATCGTGCTGACCCTGCCGGCGATCG AGCGCGAGCACTTCGCCCCATTCGCCCCCAACGGCTGGTTCGGCCCTGCCGGAACGACCGGGATGGGCATCGTCGGCGCG GCGTCGTCGATCTTCTTTGCCTACGTCGGCTTCGACGCGGTCTCGACCGCTGCCGAAGAAACCAAGAACCCGCAGCGCAA CGTGCCGATCGGCCTGATCGGAAGCCTTGCGATCTGCACCGTGTTCTACCTGCTGGTCGCCGCTGGCGCGATTGGTTCGA TCGGTGCGCAGCCGACCGCTCTGGGCGTCGCGCCGGGTTCGGCCGAGTTCACCCAGCAGTGCGCCGCGCTGCTTGCTTCG GGCCAGGAACCGCTGGTCTGCTCGAACGAGGCTCTGGCCCATGTCCTGCGCGCCATCAACTACACCTATGCTGGCGACCT GATCGGCCTTGCGGCCAACCTCGCGCTGCCGTCGGTCATCCTGATGATGCTCTACGGCCAGACGCGCATCTTCTTCGTCA TGGCGCGCGATGGCCTGCTTCCGGAGAAACTGGCCACCGTCCACCCCAAGTGGAAAACGCCTCACATCGTGACCGCAATG ACCGGCGTATTCGTCGCCATCGCGGCGGCGCTGCTTCCGGTTGGTCAGCTTGCCGACATCTCAAATTCGGGCACGCTCTT CGCGTTCTTCATGGTCGCGATCGCGGTCATGCTGCTCCGCGCCCGCGACCCGAACCGCGTCCGTCCGTTCCGCACACCGG CGGTGTGGGTCGTCGGCCCGATCGCCGCGATTGGCTGTATCTTCCTCTACTGGAACCTGCCGTTCGAGGCGAAGATGGTC CTTCCCGTCTGGGGCGCCATCGGGCTCGTGTTCTACTTCGCCTACGGCTATCGCAAGAGCCACGTCGGCCAGGGCCACGT CGAAGTCCACGAGGGTGACGCCGACGTCCCGCCGATGCCGGTCCCGCCGATCGACTGA
Upstream 100 bases:
>100_bases TGCGCGATGCCCGGTTCCCGCTAGCTTCGCGGCCATTACCTGGTTTCCGGAGCAACCGTATCGGCGGTTTCCTGCTCTGG ACCAAGGCGGGGAGAATTTC
Downstream 100 bases:
>100_bases TCGCAGCCGACTGCAAGGTCGGCAAGAAAGGGCCGCTCCTTCCCGGAGCGGCCCTTTTCGTTCGCTGGATCTGGACTGAC CGCGCCAGGCGGGCGCTGCT
Product: phospholipid binding protein
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 525; Mature: 525
Protein sequence:
>525_residues MFGRVKPLDAILATAEKKSLHRSLGPVQLTLLGVGAIIGTGIFVLTAAAAQKAGPGMMWSFVIAGFVCAVAALCYSELAS MVPVSGSAYTYSYAVVGEMLAWMVGWALILEYAVAASAVSVGWSGYFMGLLKSLTGFELPAMLQAGPTWTMNGLLPHADF STGLINVPAIVVALLVTWLLMLGTKESATFNAILVAIKVAALTMFIVLTLPAIEREHFAPFAPNGWFGPAGTTGMGIVGA ASSIFFAYVGFDAVSTAAEETKNPQRNVPIGLIGSLAICTVFYLLVAAGAIGSIGAQPTALGVAPGSAEFTQQCAALLAS GQEPLVCSNEALAHVLRAINYTYAGDLIGLAANLALPSVILMMLYGQTRIFFVMARDGLLPEKLATVHPKWKTPHIVTAM TGVFVAIAAALLPVGQLADISNSGTLFAFFMVAIAVMLLRARDPNRVRPFRTPAVWVVGPIAAIGCIFLYWNLPFEAKMV LPVWGAIGLVFYFAYGYRKSHVGQGHVEVHEGDADVPPMPVPPID
Sequences:
>Translated_525_residues MFGRVKPLDAILATAEKKSLHRSLGPVQLTLLGVGAIIGTGIFVLTAAAAQKAGPGMMWSFVIAGFVCAVAALCYSELAS MVPVSGSAYTYSYAVVGEMLAWMVGWALILEYAVAASAVSVGWSGYFMGLLKSLTGFELPAMLQAGPTWTMNGLLPHADF STGLINVPAIVVALLVTWLLMLGTKESATFNAILVAIKVAALTMFIVLTLPAIEREHFAPFAPNGWFGPAGTTGMGIVGA ASSIFFAYVGFDAVSTAAEETKNPQRNVPIGLIGSLAICTVFYLLVAAGAIGSIGAQPTALGVAPGSAEFTQQCAALLAS GQEPLVCSNEALAHVLRAINYTYAGDLIGLAANLALPSVILMMLYGQTRIFFVMARDGLLPEKLATVHPKWKTPHIVTAM TGVFVAIAAALLPVGQLADISNSGTLFAFFMVAIAVMLLRARDPNRVRPFRTPAVWVVGPIAAIGCIFLYWNLPFEAKMV LPVWGAIGLVFYFAYGYRKSHVGQGHVEVHEGDADVPPMPVPPID >Mature_525_residues MFGRVKPLDAILATAEKKSLHRSLGPVQLTLLGVGAIIGTGIFVLTAAAAQKAGPGMMWSFVIAGFVCAVAALCYSELAS MVPVSGSAYTYSYAVVGEMLAWMVGWALILEYAVAASAVSVGWSGYFMGLLKSLTGFELPAMLQAGPTWTMNGLLPHADF STGLINVPAIVVALLVTWLLMLGTKESATFNAILVAIKVAALTMFIVLTLPAIEREHFAPFAPNGWFGPAGTTGMGIVGA ASSIFFAYVGFDAVSTAAEETKNPQRNVPIGLIGSLAICTVFYLLVAAGAIGSIGAQPTALGVAPGSAEFTQQCAALLAS GQEPLVCSNEALAHVLRAINYTYAGDLIGLAANLALPSVILMMLYGQTRIFFVMARDGLLPEKLATVHPKWKTPHIVTAM TGVFVAIAAALLPVGQLADISNSGTLFAFFMVAIAVMLLRARDPNRVRPFRTPAVWVVGPIAAIGCIFLYWNLPFEAKMV LPVWGAIGLVFYFAYGYRKSHVGQGHVEVHEGDADVPPMPVPPID
Specific function: Probable Amino-Acid Or Metabolite Transport Protein. [C]
COG id: COG0531
COG function: function code E; Amino acid transporters
Gene ontology:
Cell location: Cell membrane; Multi-pass membrane protein (Potential) [H]
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the amino acid-polyamine-organocation (APC) superfamily [H]
Homologues:
Organism=Homo sapiens, GI258614003, Length=453, Percent_Identity=32.0088300220751, Blast_Score=183, Evalue=3e-46, Organism=Homo sapiens, GI258614005, Length=453, Percent_Identity=32.0088300220751, Blast_Score=183, Evalue=3e-46, Organism=Homo sapiens, GI4507047, Length=471, Percent_Identity=31.8471337579618, Blast_Score=182, Evalue=7e-46, Organism=Homo sapiens, GI258645169, Length=453, Percent_Identity=32.4503311258278, Blast_Score=178, Evalue=1e-44, Organism=Homo sapiens, GI181337167, Length=457, Percent_Identity=30.6345733041575, Blast_Score=171, Evalue=1e-42, Organism=Homo sapiens, GI114326544, Length=457, Percent_Identity=29.1028446389497, Blast_Score=170, Evalue=4e-42, Organism=Homo sapiens, GI114326550, Length=457, Percent_Identity=29.1028446389497, Blast_Score=170, Evalue=4e-42, Organism=Homo sapiens, GI110347453, Length=441, Percent_Identity=31.0657596371882, Blast_Score=163, Evalue=4e-40, Organism=Homo sapiens, GI115648063, Length=448, Percent_Identity=25, Blast_Score=94, Evalue=3e-19, Organism=Homo sapiens, GI115648022, Length=448, Percent_Identity=25, Blast_Score=94, Evalue=3e-19, Organism=Homo sapiens, GI33286428, Length=448, Percent_Identity=23.2142857142857, Blast_Score=86, Evalue=1e-16, Organism=Escherichia coli, GI87081869, Length=521, Percent_Identity=22.4568138195777, Blast_Score=91, Evalue=1e-19, Organism=Escherichia coli, GI87082023, Length=435, Percent_Identity=23.9080459770115, Blast_Score=77, Evalue=3e-15, Organism=Escherichia coli, GI87082250, Length=446, Percent_Identity=24.6636771300448, Blast_Score=73, Evalue=5e-14, Organism=Escherichia coli, GI1786302, Length=449, Percent_Identity=22.9398663697105, Blast_Score=70, Evalue=3e-13, Organism=Escherichia coli, GI87081915, Length=387, Percent_Identity=25.0645994832041, Blast_Score=69, Evalue=7e-13, Organism=Escherichia coli, GI1788480, Length=273, Percent_Identity=25.2747252747253, Blast_Score=66, Evalue=6e-12, Organism=Caenorhabditis elegans, GI17532491, Length=446, Percent_Identity=32.7354260089686, Blast_Score=192, Evalue=4e-49, Organism=Caenorhabditis elegans, GI17533459, Length=443, Percent_Identity=30.6997742663657, Blast_Score=162, Evalue=4e-40, Organism=Caenorhabditis elegans, GI17531343, Length=507, Percent_Identity=26.4299802761341, Blast_Score=143, Evalue=2e-34, Organism=Caenorhabditis elegans, GI17540018, Length=447, Percent_Identity=24.1610738255034, Blast_Score=80, Evalue=4e-15, Organism=Caenorhabditis elegans, GI17537453, Length=400, Percent_Identity=22.75, Blast_Score=74, Evalue=2e-13, Organism=Drosophila melanogaster, GI24667468, Length=441, Percent_Identity=31.0657596371882, Blast_Score=194, Evalue=2e-49, Organism=Drosophila melanogaster, GI24666159, Length=451, Percent_Identity=30.5986696230599, Blast_Score=193, Evalue=2e-49, Organism=Drosophila melanogaster, GI221512776, Length=451, Percent_Identity=30.5986696230599, Blast_Score=193, Evalue=2e-49, Organism=Drosophila melanogaster, GI24668806, Length=440, Percent_Identity=31.1363636363636, Blast_Score=193, Evalue=3e-49, Organism=Drosophila melanogaster, GI21356285, Length=440, Percent_Identity=31.1363636363636, Blast_Score=193, Evalue=3e-49, Organism=Drosophila melanogaster, GI24668802, Length=440, Percent_Identity=31.1363636363636, Blast_Score=193, Evalue=3e-49, Organism=Drosophila melanogaster, GI161077963, Length=446, Percent_Identity=28.9237668161435, Blast_Score=152, Evalue=5e-37, Organism=Drosophila melanogaster, GI281366235, Length=456, Percent_Identity=29.6052631578947, Blast_Score=144, Evalue=2e-34, Organism=Drosophila melanogaster, GI116007820, Length=456, Percent_Identity=29.6052631578947, Blast_Score=144, Evalue=2e-34, Organism=Drosophila melanogaster, GI116007818, Length=456, Percent_Identity=29.6052631578947, Blast_Score=137, Evalue=1e-32, Organism=Drosophila melanogaster, GI85725152, Length=456, Percent_Identity=29.6052631578947, Blast_Score=137, Evalue=1e-32, Organism=Drosophila melanogaster, GI221331183, Length=480, Percent_Identity=22.9166666666667, Blast_Score=68, Evalue=1e-11, Organism=Drosophila melanogaster, GI17647653, Length=480, Percent_Identity=22.9166666666667, Blast_Score=68, Evalue=1e-11, Organism=Drosophila melanogaster, GI24664379, Length=480, Percent_Identity=22.9166666666667, Blast_Score=68, Evalue=1e-11, Organism=Drosophila melanogaster, GI21357367, Length=511, Percent_Identity=22.7005870841487, Blast_Score=68, Evalue=1e-11, Organism=Drosophila melanogaster, GI45550968, Length=509, Percent_Identity=22.2003929273084, Blast_Score=67, Evalue=3e-11, Organism=Drosophila melanogaster, GI19921172, Length=509, Percent_Identity=22.2003929273084, Blast_Score=67, Evalue=3e-11,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR004841 - InterPro: IPR002293 - InterPro: IPR004758 - InterPro: IPR015606 [H]
Pfam domain/function: PF00324 AA_permease [H]
EC number: NA
Molecular weight: Translated: 55255; Mature: 55255
Theoretical pI: Translated: 7.25; Mature: 7.25
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.1 %Cys (Translated Protein) 3.8 %Met (Translated Protein) 5.0 %Cys+Met (Translated Protein) 1.1 %Cys (Mature Protein) 3.8 %Met (Mature Protein) 5.0 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MFGRVKPLDAILATAEKKSLHRSLGPVQLTLLGVGAIIGTGIFVLTAAAAQKAGPGMMWS CCCCCCHHHHHHHHHHHHHHHHCCCCEEEHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHH FVIAGFVCAVAALCYSELASMVPVSGSAYTYSYAVVGEMLAWMVGWALILEYAVAASAVS HHHHHHHHHHHHHHHHHHHHHCCCCCCCEEEHHHHHHHHHHHHHHHHHHHHHHHHHHHHH VGWSGYFMGLLKSLTGFELPAMLQAGPTWTMNGLLPHADFSTGLINVPAIVVALLVTWLL HCHHHHHHHHHHHHCCCCCCHHHHCCCCEEECCCCCCCCCCCCCCHHHHHHHHHHHHHHH MLGTKESATFNAILVAIKVAALTMFIVLTLPAIEREHFAPFAPNGWFGPAGTTGMGIVGA HHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCHHHH ASSIFFAYVGFDAVSTAAEETKNPQRNVPIGLIGSLAICTVFYLLVAAGAIGSIGAQPTA HHHHHHHHHHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCE LGVAPGSAEFTQQCAALLASGQEPLVCSNEALAHVLRAINYTYAGDLIGLAANLALPSVI EECCCCCHHHHHHHHHHHHCCCCCEEECHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH LMMLYGQTRIFFVMARDGLLPEKLATVHPKWKTPHIVTAMTGVFVAIAAALLPVGQLADI HHHHHCCCEEEEEEECCCCCHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHCCHHHHCC SNSGTLFAFFMVAIAVMLLRARDPNRVRPFRTPAVWVVGPIAAIGCIFLYWNLPFEAKMV CCCCHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHCCCCCCCEEH LPVWGAIGLVFYFAYGYRKSHVGQGHVEVHEGDADVPPMPVPPID HHHHHHHHHHHHHHHHHHHCCCCCCCEEEECCCCCCCCCCCCCCC >Mature Secondary Structure MFGRVKPLDAILATAEKKSLHRSLGPVQLTLLGVGAIIGTGIFVLTAAAAQKAGPGMMWS CCCCCCHHHHHHHHHHHHHHHHCCCCEEEHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHH FVIAGFVCAVAALCYSELASMVPVSGSAYTYSYAVVGEMLAWMVGWALILEYAVAASAVS HHHHHHHHHHHHHHHHHHHHHCCCCCCCEEEHHHHHHHHHHHHHHHHHHHHHHHHHHHHH VGWSGYFMGLLKSLTGFELPAMLQAGPTWTMNGLLPHADFSTGLINVPAIVVALLVTWLL HCHHHHHHHHHHHHCCCCCCHHHHCCCCEEECCCCCCCCCCCCCCHHHHHHHHHHHHHHH MLGTKESATFNAILVAIKVAALTMFIVLTLPAIEREHFAPFAPNGWFGPAGTTGMGIVGA HHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCHHHH ASSIFFAYVGFDAVSTAAEETKNPQRNVPIGLIGSLAICTVFYLLVAAGAIGSIGAQPTA HHHHHHHHHHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCE LGVAPGSAEFTQQCAALLASGQEPLVCSNEALAHVLRAINYTYAGDLIGLAANLALPSVI EECCCCCHHHHHHHHHHHHCCCCCEEECHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH LMMLYGQTRIFFVMARDGLLPEKLATVHPKWKTPHIVTAMTGVFVAIAAALLPVGQLADI HHHHHCCCEEEEEEECCCCCHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHCCHHHHCC SNSGTLFAFFMVAIAVMLLRARDPNRVRPFRTPAVWVVGPIAAIGCIFLYWNLPFEAKMV CCCCHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHCCCCCCCEEH LPVWGAIGLVFYFAYGYRKSHVGQGHVEVHEGDADVPPMPVPPID HHHHHHHHHHHHHHHHHHHCCCCCCCEEEECCCCCCCCCCCCCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 6.0
TargetDB status: NA
Availability: NA
References: 9579061; 9384377 [H]