| Definition | Novosphingobium aromaticivorans DSM 12444 chromosome, complete genome. |
|---|---|
| Accession | NC_007794 |
| Length | 3,561,584 |
Click here to switch to the map view.
The map label for this gene is 87198173
Identifier: 87198173
GI number: 87198173
Start: 147894
End: 149066
Strand: Direct
Name: 87198173
Synonym: Saro_0147
Alternate gene names: NA
Gene position: 147894-149066 (Clockwise)
Preceding gene: 87198172
Following gene: 87198175
Centisome position: 4.15
GC content: 67.35
Gene sequence:
>1173_bases ATGGAGAAGGCGGAGAGGCCGTATGACGTTGTCGTCTACGGGGCGACGGGGTTCACCGGGCGACTGGTCGCGGAGTATCT GGCGCGGCATTACGGGCAGGAAGGGCCGCGTTGGGCCATGGCCGGGCGATCTGGCGCGAAACTGGCAGAAGTGCGCGCCC TGATCGAGGCGCCCAAGAACACGCCGCTGATCGTGGCCGATGCCTCCGATCCCGCCAGCCTTGCCGACATGGTCCGCCAG GCCAAGGTCGTTCTTACCACAGTAGGGCCGTACCAGCTCTATGGCGAGCCATTGCTGGCGGCCTGCGTCGCGGCGGGGAC CGACTATGCGGACCTGTGCGGCGAGCCGGTGTGGATGCGGCAGATGATCGACAAGTATGGCGACGATGCCCGGCATTCGG GCGCGCGCATCTGTTTCTCGTCCGGGTTCGATTCGATCCCGTTCGACCTGGGCGTGCTCATGTTGCAGAAGGAAGCGGTC GCCCGGTTTGGCCGCCCTGCCCCGCGCGTCAAGGGGCGGGTCCGGGGCATGAAGGGCGGCGCTTCGGGCGGCACGGCGGC AAGCCTGAAGGCCACGCTCGCGGCGCTCGGCAAGGACCCGTCGCTCATCCCGCTGATGGCCAGCCCATTCTGCCTGACCC CTGGTTTCGAGGGGCCGGCCCAGCCAGCCGGCGACAAGGTGCAGCACGACGACGCGTTGGGGAGCTGGGAAACGCCCTTC ATCATGGCGGCGATCAACACCAAGAACGTTCATCGCACCAACGCCTTGCTCGGCCACGCCTGGGGCAAGGACTTCGTCTA TGACGAGATGGTACTGACCGGTCCCGGCGAACAGGGCAAGGCGGTGGCCGAACACATGGCGAAGACGCCGATGATCGGCC GCCCCGACGATCCGCTGCCCGGCGAAGGGCCGTCGAAGGAAGAGCGCGAGACCGGCTTCTACGACGTGCTCTTCGTCGGG GAGATGCCTGGCGGGGAGACGATTCGCTATGGTGTGAAGGGCCGCTATGACCCCGGCTATGGATCGACAAGCCGGATGAT CGCGGAGACCGGCATCGCGCTGCTTTCGAGTACTGCGGCCGGGGGAATCGGTACGCCCGGCGCGATCCTGGGCGAAACGC TGGTCGCGCGGCTGCGCGCCCATGCCGAGATTGCGTTCGCGCCCGAGGACTGA
Upstream 100 bases:
>100_bases GGCGCTGGCGCTTCACGCTTAACCCCGCACTTAAATCCGGTTGCAATCGCCACTGATTCGGCCAAGCTTCGCCGCACAAG AACAACAGGCGGAGAGGCTG
Downstream 100 bases:
>100_bases CCTCAAAAGCGACGAAAGCCCGCCTGCCGCTACGGAGGGGATCCGCGGCAGGCGGGCTCGTCTACCGCGCCCGAATCTGG ATAGGGGGGATCAGGCGACG
Product: saccharopine dehydrogenase
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 390; Mature: 390
Protein sequence:
>390_residues MEKAERPYDVVVYGATGFTGRLVAEYLARHYGQEGPRWAMAGRSGAKLAEVRALIEAPKNTPLIVADASDPASLADMVRQ AKVVLTTVGPYQLYGEPLLAACVAAGTDYADLCGEPVWMRQMIDKYGDDARHSGARICFSSGFDSIPFDLGVLMLQKEAV ARFGRPAPRVKGRVRGMKGGASGGTAASLKATLAALGKDPSLIPLMASPFCLTPGFEGPAQPAGDKVQHDDALGSWETPF IMAAINTKNVHRTNALLGHAWGKDFVYDEMVLTGPGEQGKAVAEHMAKTPMIGRPDDPLPGEGPSKEERETGFYDVLFVG EMPGGETIRYGVKGRYDPGYGSTSRMIAETGIALLSSTAAGGIGTPGAILGETLVARLRAHAEIAFAPED
Sequences:
>Translated_390_residues MEKAERPYDVVVYGATGFTGRLVAEYLARHYGQEGPRWAMAGRSGAKLAEVRALIEAPKNTPLIVADASDPASLADMVRQ AKVVLTTVGPYQLYGEPLLAACVAAGTDYADLCGEPVWMRQMIDKYGDDARHSGARICFSSGFDSIPFDLGVLMLQKEAV ARFGRPAPRVKGRVRGMKGGASGGTAASLKATLAALGKDPSLIPLMASPFCLTPGFEGPAQPAGDKVQHDDALGSWETPF IMAAINTKNVHRTNALLGHAWGKDFVYDEMVLTGPGEQGKAVAEHMAKTPMIGRPDDPLPGEGPSKEERETGFYDVLFVG EMPGGETIRYGVKGRYDPGYGSTSRMIAETGIALLSSTAAGGIGTPGAILGETLVARLRAHAEIAFAPED >Mature_390_residues MEKAERPYDVVVYGATGFTGRLVAEYLARHYGQEGPRWAMAGRSGAKLAEVRALIEAPKNTPLIVADASDPASLADMVRQ AKVVLTTVGPYQLYGEPLLAACVAAGTDYADLCGEPVWMRQMIDKYGDDARHSGARICFSSGFDSIPFDLGVLMLQKEAV ARFGRPAPRVKGRVRGMKGGASGGTAASLKATLAALGKDPSLIPLMASPFCLTPGFEGPAQPAGDKVQHDDALGSWETPF IMAAINTKNVHRTNALLGHAWGKDFVYDEMVLTGPGEQGKAVAEHMAKTPMIGRPDDPLPGEGPSKEERETGFYDVLFVG EMPGGETIRYGVKGRYDPGYGSTSRMIAETGIALLSSTAAGGIGTPGAILGETLVARLRAHAEIAFAPED
Specific function: Unknown
COG id: COG3268
COG function: function code S; Uncharacterized conserved protein
Gene ontology:
Cell location: Cell membrane; Single-pass membrane protein (Potential) [H]
Metaboloic importance: NA
Operon status: Not Known
Operon components: None
Similarity: Belongs to the saccharopine dehydrogenase family. Enoyl reductase subfamily [H]
Homologues:
Organism=Homo sapiens, GI55770836, Length=171, Percent_Identity=42.6900584795322, Blast_Score=128, Evalue=8e-30, Organism=Caenorhabditis elegans, GI32567112, Length=156, Percent_Identity=47.4358974358974, Blast_Score=139, Evalue=2e-33, Organism=Caenorhabditis elegans, GI17560066, Length=156, Percent_Identity=47.4358974358974, Blast_Score=139, Evalue=2e-33, Organism=Caenorhabditis elegans, GI71991033, Length=212, Percent_Identity=35.8490566037736, Blast_Score=113, Evalue=2e-25, Organism=Drosophila melanogaster, GI24646278, Length=161, Percent_Identity=36.0248447204969, Blast_Score=115, Evalue=5e-26, Organism=Drosophila melanogaster, GI24644140, Length=156, Percent_Identity=37.1794871794872, Blast_Score=114, Evalue=1e-25, Organism=Drosophila melanogaster, GI24644142, Length=156, Percent_Identity=37.1794871794872, Blast_Score=114, Evalue=1e-25, Organism=Drosophila melanogaster, GI21356081, Length=156, Percent_Identity=37.1794871794872, Blast_Score=114, Evalue=1e-25,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR016040 - InterPro: IPR005097 [H]
Pfam domain/function: PF03435 Saccharop_dh [H]
EC number: NA
Molecular weight: Translated: 41241; Mature: 41241
Theoretical pI: Translated: 5.95; Mature: 5.95
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.0 %Cys (Translated Protein) 3.6 %Met (Translated Protein) 4.6 %Cys+Met (Translated Protein) 1.0 %Cys (Mature Protein) 3.6 %Met (Mature Protein) 4.6 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MEKAERPYDVVVYGATGFTGRLVAEYLARHYGQEGPRWAMAGRSGAKLAEVRALIEAPKN CCCCCCCCEEEEECCCCCHHHHHHHHHHHHCCCCCCEEEECCCCCCHHHHHHHHHHCCCC TPLIVADASDPASLADMVRQAKVVLTTVGPYQLYGEPLLAACVAAGTDYADLCGEPVWMR CCEEEECCCCCHHHHHHHHHCEEEEEECCCHHHHCCHHHHHHHHCCCCHHHHCCCHHHHH QMIDKYGDDARHSGARICFSSGFDSIPFDLGVLMLQKEAVARFGRPAPRVKGRVRGMKGG HHHHHHCCCCCCCCCEEEECCCCCCCCHHHHHHHHHHHHHHHCCCCCCHHHHHHCCCCCC ASGGTAASLKATLAALGKDPSLIPLMASPFCLTPGFEGPAQPAGDKVQHDDALGSWETPF CCCCCHHHHHHHHHHHCCCCCEEEEECCCEEECCCCCCCCCCCCCCCCCCCCCCCCCCCE IMAAINTKNVHRTNALLGHAWGKDFVYDEMVLTGPGEQGKAVAEHMAKTPMIGRPDDPLP EEEEECCCCCHHHHHHHHHCCCCCCEECCEEEECCCCCHHHHHHHHHHCCCCCCCCCCCC GEGPSKEERETGFYDVLFVGEMPGGETIRYGVKGRYDPGYGSTSRMIAETGIALLSSTAA CCCCCCHHHHCCCEEEEEEECCCCCCEEEECCCCCCCCCCCCHHHHHHHHHHHHHHHCCC GGIGTPGAILGETLVARLRAHAEIAFAPED CCCCCCHHHHHHHHHHHHHHCCEEEECCCC >Mature Secondary Structure MEKAERPYDVVVYGATGFTGRLVAEYLARHYGQEGPRWAMAGRSGAKLAEVRALIEAPKN CCCCCCCCEEEEECCCCCHHHHHHHHHHHHCCCCCCEEEECCCCCCHHHHHHHHHHCCCC TPLIVADASDPASLADMVRQAKVVLTTVGPYQLYGEPLLAACVAAGTDYADLCGEPVWMR CCEEEECCCCCHHHHHHHHHCEEEEEECCCHHHHCCHHHHHHHHCCCCHHHHCCCHHHHH QMIDKYGDDARHSGARICFSSGFDSIPFDLGVLMLQKEAVARFGRPAPRVKGRVRGMKGG HHHHHHCCCCCCCCCEEEECCCCCCCCHHHHHHHHHHHHHHHCCCCCCHHHHHHCCCCCC ASGGTAASLKATLAALGKDPSLIPLMASPFCLTPGFEGPAQPAGDKVQHDDALGSWETPF CCCCCHHHHHHHHHHHCCCCCEEEEECCCEEECCCCCCCCCCCCCCCCCCCCCCCCCCCE IMAAINTKNVHRTNALLGHAWGKDFVYDEMVLTGPGEQGKAVAEHMAKTPMIGRPDDPLP EEEEECCCCCHHHHHHHHHCCCCCCEECCEEEECCCCCHHHHHHHHHHCCCCCCCCCCCC GEGPSKEERETGFYDVLFVGEMPGGETIRYGVKGRYDPGYGSTSRMIAETGIALLSSTAA CCCCCCHHHHCCCEEEEEEECCCCCCEEEECCCCCCCCCCCCHHHHHHHHHHHHHHHCCC GGIGTPGAILGETLVARLRAHAEIAFAPED CCCCCCHHHHHHHHHHHHHHCCEEEECCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 6.0
TargetDB status: NA
Availability: NA
References: 9634230 [H]