The gene/protein map for NC_007794 is currently unavailable.
Definition Novosphingobium aromaticivorans DSM 12444 chromosome, complete genome.
Accession NC_007794
Length 3,561,584

Click here to switch to the map view.

The map label for this gene is 87200488

Identifier: 87200488

GI number: 87200488

Start: 2674487

End: 2677045

Strand: Reverse

Name: 87200488

Synonym: Saro_2475

Alternate gene names: NA

Gene position: 2677045-2674487 (Counterclockwise)

Preceding gene: 87200489

Following gene: 87200481

Centisome position: 75.16

GC content: 67.8

Gene sequence:

>2559_bases
ATGACCCTCGCGACCAGAAGCCTCATCAAGAACCTCTCCTCCGCACTGGGCGCCCAGGCCGAGCGGGAGCAATTGATTGC
CCTGATTTCGATCGCGACGCAGACCGTCGCACCGCTCTGGCCACTCGACAGTGCCATCGCCGTCAATCCACTGTCGGGCT
TCGAGGAACAGCCGTTCGAGGAAGTGCTGCCCGAGGCCGCAGCCCTGTTCGGCGCAAGGCCCACGCTCTCGCTGAACGAA
TGGCGCACGCTCATGGATGAAGGGCGCATCGACCAGGTTTCGCTGCGCAAGGCGGTGGTCAATGCGCTGGGCGGACCGGA
TGAAGCGTTCGCATTGCTGGGGCCTGATCTCAACGCCTACAACCTGCTCGTCGCGCGGCTGCTCGACATGGAGGCAGAGG
ACGTGCCCCCGGTGCGGCGCGCGCTGTCGCCCGGCATGGCCACCCTTGCGCGCTGGCTGGCCGCCTTCTTCGATCGCAAC
GCCGCTTTGCGCCTCCCGGGGCGGGAACGTGGGCTCTATGCTTGTCTTTCAGAAGCGCTGCGCCACGATCCCGCGCTGCT
GCGCGCCAGCAACGCCACCGGCCGCGCCTGGCTGGAAAACGCTCCGGCAGACCCGGTGGACATGCTGATCCTTGCCGCGC
GCCGCGACGCCGTCGGGCCGGAGCGTCGTTTGCCCTGGCTGCGCGCCATGGTGGCGAGCCTGCCGGGCTGGGCAGCACAT
TTGCGCTGGCGAAGCGAACATGCGGGACCTGCCACCAGCCTTGGCGCGCCTGCTTGCATGGCGGACCTCATGGCGCTGGT
GGCGCTGGTGCAGGGCGTGGTGCAACCGGCACCGCGTGCCGTGCCTGATCCGGACTGCCCGGAAGATGTCGAGGCTGCAC
TTTTGGTGCACTGCGGAGTGGCGCAGGACGCTCCGGCCAAGTGGCCGGAGGCTGGCCGGGCACGGCTGCGCGCCGTCGCA
GCGCTGACCCACGCTCAACTCGGCCTGATCTTTCAGGAGGCCGCCGAGTCCAGCTTCCTTGGCCAACTGGCTCCACAGCT
CGAGGGCGCCTCTGCCCGGCTGGCTGCGCCGCAGTCCACGCTTCGCCCTGAAGCGCAAGCGATCTTCTGCATCGACGTTC
GCTCGGAACCGATGCGGCGGGCGCTGGAAACGCAGGGGCGGTTCGAGACACTCGGCTATGCAGGGTTCTTCGGCCTGCCG
ATCGCCATCAACCCTGCCTGCGCTGCGCCTGCGCGCAACCAGTTGCCGGTACTGCTGTCGCCCTCGCACGTGGTGCCCGA
ACGCGCCATGCCGGGGCGTGAGGCCGAGGCGACGGCCATGCTGGCCCGTCATGCTGCGCTTGGCGATGCCCAGGCGATGC
TCGATACGACCAAGAGCGGCGCGATCGGCTTTGCCGCGGCGGAAGCCGCCGGACCTGTCGCTGCGGTGGCCATGCTTGCT
CGCACTCTCGCCCCCCGGTTGACCCATCGGTTGCGCCAGCGTTTGATCGGGGAGCGCGGGCATGTGCTCGCCCCGGCGGC
GTGCAACGATCAAGATCACGAACGTCATGACGGGCAGGGTGAAGGTATTCCGCTGGCGCAGCGCGTGGCCTATGCGCGGG
GTATGTTCGCGTTGACCGGACTTTCGCCGCAGACGGCGCGGCTGGTGGCGCTGGTGGGGCATGGCGGCTGCACCACCAAC
AATGCCTTTGCAGCCAGCCTCGATTGCGGAGCTTGCGGCGGGCATCCCGGCGGGCCAAATGCGCGGCTCATGGCGGCTAT
CCTCAACGATCCCGCCGTGCGGAAGGGCCTGGCTGCAAAGGGCGTGGACTTGCCGCATGATACCTGGTTCATCGCCGCAC
AGCACGACACCACGCGCGACGAGGTGGAAATCTTCGACCGCCATCTCGTGCCCGCCAGCCATGTGGCGGATCTTGCCCGG
TTCGAGCGGGCACTCTCCTGCGCAGGGGCGCAGAGTCGCGATGAACGCGCGGCGCGGCTGGACCGGACGGCCGACGACCT
GCTGACGGGCGCTGCACACTGGGGCGAAGTGCGTCCCGAATGGGGCCTTTCGGGCAATGCCGCCTTCATCGTTGGGCCGC
GCGCGCTGACGCGGGAGGTCGATCTGGGCGGCAACGCCTTCCTTCACAGCTACGATTGGAAGAAGGATGACGATGGCAGC
GCGCTCACCGGGATCATGACCGCGCCGATGATCGTGGCGCAGTGGATCAACTGCCAGTACCTGTTCTCGACCATCGACAA
CGAGATTTTCGGCGCGGGCGACAAGACCACGCAGAATGTGGTCGGCGGCTTCGGCGTGGTGCAGGGGAGCGGCGGAGACC
TTTGCACTGGCCTGCCGCGCCAATCGCTGTTCCGCGACGATGGCACCCCGTACCACACACCGCGCCGCCTCGCGGTGATC
GTGCATGCGCCGCTGCAACGGGTACAGGACATCGTGCTGCGCCACGACGCGGTGGGCCGTCTCGTGGAAAATGGCTGGGT
CAATCTGGTTGTGATCGACCCGTGGAAGCACAAGGCCCATCACTGGGTACGCGGCGATTGGGCCGTGCGACCATGCTGA

Upstream 100 bases:

>100_bases
GCGAGCGCAACCTGCCACCAGCGCTGTTCGCCCGCCTGTTCCATGCCGGAAATCTCTCGGCCTGACCTCTGCAATTTCCA
GCTCTCAAGGACGCCATGCC

Downstream 100 bases:

>100_bases
TGCTCGCAGGCGCGTAATCCCCAGCCGGCGGTGCCTGTCGTGGGCACCGCAGCGCCAATCCGAATTTGCGCAAGCTTCAG
GGCCGCACCACACACCTGAA

Product: hypothetical protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 852; Mature: 851

Protein sequence:

>852_residues
MTLATRSLIKNLSSALGAQAEREQLIALISIATQTVAPLWPLDSAIAVNPLSGFEEQPFEEVLPEAAALFGARPTLSLNE
WRTLMDEGRIDQVSLRKAVVNALGGPDEAFALLGPDLNAYNLLVARLLDMEAEDVPPVRRALSPGMATLARWLAAFFDRN
AALRLPGRERGLYACLSEALRHDPALLRASNATGRAWLENAPADPVDMLILAARRDAVGPERRLPWLRAMVASLPGWAAH
LRWRSEHAGPATSLGAPACMADLMALVALVQGVVQPAPRAVPDPDCPEDVEAALLVHCGVAQDAPAKWPEAGRARLRAVA
ALTHAQLGLIFQEAAESSFLGQLAPQLEGASARLAAPQSTLRPEAQAIFCIDVRSEPMRRALETQGRFETLGYAGFFGLP
IAINPACAAPARNQLPVLLSPSHVVPERAMPGREAEATAMLARHAALGDAQAMLDTTKSGAIGFAAAEAAGPVAAVAMLA
RTLAPRLTHRLRQRLIGERGHVLAPAACNDQDHERHDGQGEGIPLAQRVAYARGMFALTGLSPQTARLVALVGHGGCTTN
NAFAASLDCGACGGHPGGPNARLMAAILNDPAVRKGLAAKGVDLPHDTWFIAAQHDTTRDEVEIFDRHLVPASHVADLAR
FERALSCAGAQSRDERAARLDRTADDLLTGAAHWGEVRPEWGLSGNAAFIVGPRALTREVDLGGNAFLHSYDWKKDDDGS
ALTGIMTAPMIVAQWINCQYLFSTIDNEIFGAGDKTTQNVVGGFGVVQGSGGDLCTGLPRQSLFRDDGTPYHTPRRLAVI
VHAPLQRVQDIVLRHDAVGRLVENGWVNLVVIDPWKHKAHHWVRGDWAVRPC

Sequences:

>Translated_852_residues
MTLATRSLIKNLSSALGAQAEREQLIALISIATQTVAPLWPLDSAIAVNPLSGFEEQPFEEVLPEAAALFGARPTLSLNE
WRTLMDEGRIDQVSLRKAVVNALGGPDEAFALLGPDLNAYNLLVARLLDMEAEDVPPVRRALSPGMATLARWLAAFFDRN
AALRLPGRERGLYACLSEALRHDPALLRASNATGRAWLENAPADPVDMLILAARRDAVGPERRLPWLRAMVASLPGWAAH
LRWRSEHAGPATSLGAPACMADLMALVALVQGVVQPAPRAVPDPDCPEDVEAALLVHCGVAQDAPAKWPEAGRARLRAVA
ALTHAQLGLIFQEAAESSFLGQLAPQLEGASARLAAPQSTLRPEAQAIFCIDVRSEPMRRALETQGRFETLGYAGFFGLP
IAINPACAAPARNQLPVLLSPSHVVPERAMPGREAEATAMLARHAALGDAQAMLDTTKSGAIGFAAAEAAGPVAAVAMLA
RTLAPRLTHRLRQRLIGERGHVLAPAACNDQDHERHDGQGEGIPLAQRVAYARGMFALTGLSPQTARLVALVGHGGCTTN
NAFAASLDCGACGGHPGGPNARLMAAILNDPAVRKGLAAKGVDLPHDTWFIAAQHDTTRDEVEIFDRHLVPASHVADLAR
FERALSCAGAQSRDERAARLDRTADDLLTGAAHWGEVRPEWGLSGNAAFIVGPRALTREVDLGGNAFLHSYDWKKDDDGS
ALTGIMTAPMIVAQWINCQYLFSTIDNEIFGAGDKTTQNVVGGFGVVQGSGGDLCTGLPRQSLFRDDGTPYHTPRRLAVI
VHAPLQRVQDIVLRHDAVGRLVENGWVNLVVIDPWKHKAHHWVRGDWAVRPC
>Mature_851_residues
TLATRSLIKNLSSALGAQAEREQLIALISIATQTVAPLWPLDSAIAVNPLSGFEEQPFEEVLPEAAALFGARPTLSLNEW
RTLMDEGRIDQVSLRKAVVNALGGPDEAFALLGPDLNAYNLLVARLLDMEAEDVPPVRRALSPGMATLARWLAAFFDRNA
ALRLPGRERGLYACLSEALRHDPALLRASNATGRAWLENAPADPVDMLILAARRDAVGPERRLPWLRAMVASLPGWAAHL
RWRSEHAGPATSLGAPACMADLMALVALVQGVVQPAPRAVPDPDCPEDVEAALLVHCGVAQDAPAKWPEAGRARLRAVAA
LTHAQLGLIFQEAAESSFLGQLAPQLEGASARLAAPQSTLRPEAQAIFCIDVRSEPMRRALETQGRFETLGYAGFFGLPI
AINPACAAPARNQLPVLLSPSHVVPERAMPGREAEATAMLARHAALGDAQAMLDTTKSGAIGFAAAEAAGPVAAVAMLAR
TLAPRLTHRLRQRLIGERGHVLAPAACNDQDHERHDGQGEGIPLAQRVAYARGMFALTGLSPQTARLVALVGHGGCTTNN
AFAASLDCGACGGHPGGPNARLMAAILNDPAVRKGLAAKGVDLPHDTWFIAAQHDTTRDEVEIFDRHLVPASHVADLARF
ERALSCAGAQSRDERAARLDRTADDLLTGAAHWGEVRPEWGLSGNAAFIVGPRALTREVDLGGNAFLHSYDWKKDDDGSA
LTGIMTAPMIVAQWINCQYLFSTIDNEIFGAGDKTTQNVVGGFGVVQGSGGDLCTGLPRQSLFRDDGTPYHTPRRLAVIV
HAPLQRVQDIVLRHDAVGRLVENGWVNLVVIDPWKHKAHHWVRGDWAVRPC

Specific function: Unknown

COG id: COG3002

COG function: function code S; Uncharacterized protein conserved in bacteria

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Belongs to the UPF0753 family

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): Y2475_NOVAD (Q2G5G2)

Other databases:

- EMBL:   CP000248
- RefSeq:   YP_497745.1
- STRING:   Q2G5G2
- GeneID:   3916794
- GenomeReviews:   CP000248_GR
- KEGG:   nar:Saro_2475
- eggNOG:   COG3002
- HOGENOM:   HBG520117
- OMA:   LWQAELS
- BioCyc:   NARO279238:SARO_2475-MONOMER
- HAMAP:   MF_01871
- InterPro:   IPR018752

Pfam domain/function: PF10070 DUF2309

EC number: NA

Molecular weight: Translated: 91123; Mature: 90992

Theoretical pI: Translated: 6.61; Mature: 6.61

Prosite motif: PS00211 ABC_TRANSPORTER_1

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.6 %Cys     (Translated Protein)
2.0 %Met     (Translated Protein)
3.6 %Cys+Met (Translated Protein)
1.6 %Cys     (Mature Protein)
1.9 %Met     (Mature Protein)
3.5 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MTLATRSLIKNLSSALGAQAEREQLIALISIATQTVAPLWPLDSAIAVNPLSGFEEQPFE
CCCHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHCCCCCCCCCEEECCCCCCCCCCHH
EVLPEAAALFGARPTLSLNEWRTLMDEGRIDQVSLRKAVVNALGGPDEAFALLGPDLNAY
HHHHHHHHHHCCCCCCCHHHHHHHHHCCCCCHHHHHHHHHHHHCCCCCEEEEECCCCCHH
NLLVARLLDMEAEDVPPVRRALSPGMATLARWLAAFFDRNAALRLPGRERGLYACLSEAL
HHHHHHHHCCCCCCCCHHHHHHCCCHHHHHHHHHHHHCCCCEEECCCHHHHHHHHHHHHH
RHDPALLRASNATGRAWLENAPADPVDMLILAARRDAVGPERRLPWLRAMVASLPGWAAH
HCCCCEEEECCCCCCHHHCCCCCCHHHHHHHHHHHCCCCCHHCCHHHHHHHHHCCCHHHH
LRWRSEHAGPATSLGAPACMADLMALVALVQGVVQPAPRAVPDPDCPEDVEAALLVHCGV
HEECCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCHHHHHHHHHHCCC
AQDAPAKWPEAGRARLRAVAALTHAQLGLIFQEAAESSFLGQLAPQLEGASARLAAPQST
CCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCEECCCHHH
LRPEAQAIFCIDVRSEPMRRALETQGRFETLGYAGFFGLPIAINPACAAPARNQLPVLLS
CCCCCCEEEEEECCCHHHHHHHHHCCCCHHCCCCCCCCCCEEECCCCCCCCCCCCCEEEC
PSHVVPERAMPGREAEATAMLARHAALGDAQAMLDTTKSGAIGFAAAEAAGPVAAVAMLA
CCCCCCCCCCCCCCHHHHHHHHHHHHHCCHHHHHHCCCCCCCEEEHHHHCCHHHHHHHHH
RTLAPRLTHRLRQRLIGERGHVLAPAACNDQDHERHDGQGEGIPLAQRVAYARGMFALTG
HHHHHHHHHHHHHHHHCCCCCEECCCCCCCCCHHHCCCCCCCCCHHHHHHHHHCCCEEEC
LSPQTARLVALVGHGGCTTNNAFAASLDCGACGGHPGGPNARLMAAILNDPAVRKGLAAK
CCCCCEEEEEEEECCCCCCCCCEEEECCCCCCCCCCCCCCHHHHHHHHCCHHHHHCCHHC
GVDLPHDTWFIAAQHDTTRDEVEIFDRHLVPASHVADLARFERALSCAGAQSRDERAARL
CCCCCCCCEEEEECCCCCHHHHHHHHHHCCCHHHHHHHHHHHHHHHHCCCCCHHHHHHHH
DRTADDLLTGAAHWGEVRPEWGLSGNAAFIVGPRALTREVDLGGNAFLHSYDWKKDDDGS
HCCHHHHHHHHHHCCCCCCCCCCCCCEEEEECCHHHHEEECCCCCEEEECCCCCCCCCCC
ALTGIMTAPMIVAQWINCQYLFSTIDNEIFGAGDKTTQNVVGGFGVVQGSGGDLCTGLPR
HHHHHHHHHHHHHHHHHHHHHHHHHCHHHCCCCCCHHHHHHCCCEEEECCCCCCCCCCCH
QSLFRDDGTPYHTPRRLAVIVHAPLQRVQDIVLRHDAVGRLVENGWVNLVVIDPWKHKAH
HHHHCCCCCCCCCCCEEEEEEHHHHHHHHHHHHHHHHHHHHHHCCCEEEEEECCCCCCCC
HWVRGDWAVRPC
CEECCCEEECCC
>Mature Secondary Structure 
TLATRSLIKNLSSALGAQAEREQLIALISIATQTVAPLWPLDSAIAVNPLSGFEEQPFE
CCHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHCCCCCCCCCEEECCCCCCCCCCHH
EVLPEAAALFGARPTLSLNEWRTLMDEGRIDQVSLRKAVVNALGGPDEAFALLGPDLNAY
HHHHHHHHHHCCCCCCCHHHHHHHHHCCCCCHHHHHHHHHHHHCCCCCEEEEECCCCCHH
NLLVARLLDMEAEDVPPVRRALSPGMATLARWLAAFFDRNAALRLPGRERGLYACLSEAL
HHHHHHHHCCCCCCCCHHHHHHCCCHHHHHHHHHHHHCCCCEEECCCHHHHHHHHHHHHH
RHDPALLRASNATGRAWLENAPADPVDMLILAARRDAVGPERRLPWLRAMVASLPGWAAH
HCCCCEEEECCCCCCHHHCCCCCCHHHHHHHHHHHCCCCCHHCCHHHHHHHHHCCCHHHH
LRWRSEHAGPATSLGAPACMADLMALVALVQGVVQPAPRAVPDPDCPEDVEAALLVHCGV
HEECCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCHHHHHHHHHHCCC
AQDAPAKWPEAGRARLRAVAALTHAQLGLIFQEAAESSFLGQLAPQLEGASARLAAPQST
CCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCEECCCHHH
LRPEAQAIFCIDVRSEPMRRALETQGRFETLGYAGFFGLPIAINPACAAPARNQLPVLLS
CCCCCCEEEEEECCCHHHHHHHHHCCCCHHCCCCCCCCCCEEECCCCCCCCCCCCCEEEC
PSHVVPERAMPGREAEATAMLARHAALGDAQAMLDTTKSGAIGFAAAEAAGPVAAVAMLA
CCCCCCCCCCCCCCHHHHHHHHHHHHHCCHHHHHHCCCCCCCEEEHHHHCCHHHHHHHHH
RTLAPRLTHRLRQRLIGERGHVLAPAACNDQDHERHDGQGEGIPLAQRVAYARGMFALTG
HHHHHHHHHHHHHHHHCCCCCEECCCCCCCCCHHHCCCCCCCCCHHHHHHHHHCCCEEEC
LSPQTARLVALVGHGGCTTNNAFAASLDCGACGGHPGGPNARLMAAILNDPAVRKGLAAK
CCCCCEEEEEEEECCCCCCCCCEEEECCCCCCCCCCCCCCHHHHHHHHCCHHHHHCCHHC
GVDLPHDTWFIAAQHDTTRDEVEIFDRHLVPASHVADLARFERALSCAGAQSRDERAARL
CCCCCCCCEEEEECCCCCHHHHHHHHHHCCCHHHHHHHHHHHHHHHHCCCCCHHHHHHHH
DRTADDLLTGAAHWGEVRPEWGLSGNAAFIVGPRALTREVDLGGNAFLHSYDWKKDDDGS
HCCHHHHHHHHHHCCCCCCCCCCCCCEEEEECCHHHHEEECCCCCEEEECCCCCCCCCCC
ALTGIMTAPMIVAQWINCQYLFSTIDNEIFGAGDKTTQNVVGGFGVVQGSGGDLCTGLPR
HHHHHHHHHHHHHHHHHHHHHHHHHCHHHCCCCCCHHHHHHCCCEEEECCCCCCCCCCCH
QSLFRDDGTPYHTPRRLAVIVHAPLQRVQDIVLRHDAVGRLVENGWVNLVVIDPWKHKAH
HHHHCCCCCCCCCCCEEEEEEHHHHHHHHHHHHHHHHHHHHHHCCCEEEEEECCCCCCCC
HWVRGDWAVRPC
CEECCCEEECCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA