The gene/protein map for NC_007794 is currently unavailable.
Definition Novosphingobium aromaticivorans DSM 12444 chromosome, complete genome.
Accession NC_007794
Length 3,561,584

Click here to switch to the map view.

The map label for this gene is 87198147

Identifier: 87198147

GI number: 87198147

Start: 123162

End: 125729

Strand: Direct

Name: 87198147

Synonym: Saro_0121

Alternate gene names: NA

Gene position: 123162-125729 (Clockwise)

Preceding gene: 87198146

Following gene: 87198148

Centisome position: 3.46

GC content: 65.77

Gene sequence:

>2568_bases
ATGCCCGCCACATTCCCATCCATGGCCCAGCGCATTCCCGCCCAGCCTCGAAAGTCCGCGCACACCGGCGTGGTCAAGGC
GGTGCTCGGGCCGACCAATACGGGCAAGACTCACCTCGCGATCGAACGGCTTTGTGCGCATTCCTCGGGAGCGATCGGAT
TTCCGCTGCGGCTGTTGGCGCGCGAGGTCTACGATCGGGTCTGCGCGATCAAGGGGGCCGACAATGTCGCTCTGATCACT
GGTGAAGAACGGATCGAGCCCAAGGGCGCGCGCTGGCACCTGTGCACCGTCGAAGCGATGCCTTCCCGTCCGGACCTCGC
GTTCGTCGCGCTCGATGAGGCGCAACTTTCCGCCGATCCCGAACGTGGCCATGTGTTCACCGACCGCCTGATGCACACGC
GCGGTCGTGAGGAAACCATGTTGCTTGGCTCCTCGACGCTCGAGCCGATGGTGAAAGCCTTGGTACCCGAGGCCGAGGTC
GTCACGCGCCCGCGCTTTTCAACGCTTACCCATGTCGGCGCGAAGAAGCTTTCGCGCATTCCTCCCAGAAGCGCCATCGT
CGCCTTCAGTGCCGAGCAGGTCTATGTCATGGCCGAAATGCTGCGGCGCTTCCGGGGTGGCGCTGCGGTGGTCATGGGCG
CGCTCAGCCCGCAGACGCGAAACGCCCAGGTTGCGATGTACCAGGCTGGTGAGGTCGATTACCTTGTCGCGACGGATGCC
ATCGGCATGGGATTGAATCTCGATGTCCATCACGTTGCTTTTGCCGGGTTGTCCAAGTTTGACGGACACCGCCAGCGCCG
CCTGACCACGGCGGAGATGGCCCAGATCGCAGGCCGTGCCGGACGGCACCAGCGCGATGGGACTTTCGGTGCGCTGGCCG
GAATGGGCGGGCACGATCCCGAATTCACGCCGGAAGAGATCTACGCGATCGAGGAGCACCGTTTCGCGCCCCTCACCCGC
CTGTTCTGGCGCGAGGCAGAGCCGCGTTTCGACAGCATTGCAACGCTGATCGAGGACCTCGAGAGCCCTCCTCCCCGGCC
TGAATTGGCAACGCCGCCGCAAGCCATCGATCTTGCCGTGCTGAAACGGCTGGCCGAAGACGTCGACATCGCATCGGGAG
TGCGCGGACAGCGTTCCGTCCAACGTTTCTGGGACGTCTGCCGCCTGCCCGATTTCCGCCAGCAAGGGTATGAAACACAC
AGCCGCTTTGTTGCGCGCCTGTGGCAGGATCTGCGCCATGGCTATCTCGGCGCGGATTACGTGGCGCAGGCCATCGCGCA
GCTCGACAACCCGTCGGGCGACATCGATACGCTGCAGGCACGCATCGCCGCGATCCGTTCGTGGGCTTACATCGCTCAGC
GCCCCGACTGGGTCTTGGCGAAGGACGAGATGTCCGCCCGCGCCCGTGCAGTTGAAGCTCGTCTTTCCGATGCGCTCCAC
GCGCGCCTGACCGAACGTTTCGTCAATCGTCGGACCGCCGTACTCATGCGCAAGGCCGGGGCCGATGCGGGCCTCCTGCC
GGTCCGGCTGGGCGATGAGGGCGCGGTCCTGGTCGACGATGAGCCCATCGGTCACCTTGAAGGCTTCCGCTTCGTCGTCG
ATCCCCTGGCCCGCGCCGAGGACCGCAAGCTTCTGCTTGCCGCCGCCGAACGTCATCTGCCCGGTCTTCTTGCATCCCGC
GCCAACGTCCTTGTCGCGGCTGCCGGCGAGCCTGACGGGATCGAGTTCGAGGATACGGCGCTGGTCTGGCAGGACACCGT
CGTTGCCCGAATCGAACGCGGACGTCACATGCTTTCGCCGCGTATCAAGCCGGACCTCGCGCTCGACCGTCTTGCTCCCG
GTTGCAAGGCCGAAGTCCTTGCTGCACTCGATGGCTGGTTCGCGGCACAGCACAAGCGGCACCTTGCGCCGATCCTCGCG
CTCGATGAAGCCAGTCGTGATCCGGCATCCGGGCCTGAATTGCGCGCGTTGCTCTTGCATCTTGTTGAATCGGGTGGCGT
TCTTCCGCGTGAGCAATCGGGGCTGGACCGGCTCGATCCTGCCCAGCGCGACCGCTTGAGGAAGCTTGGTGTGCGGATTG
GCTCGCTCGATCTGTTCCTGCCCGCCGCGCTTCGCCCGGCTGCCATGCAGGCCTGGCACAGGCTGGCGCGGATCTGGAGC
AGACCTTTGCCCTTGCCGCCTGAATCGATGCAGCCCGTCGTCCATGCGAAGATCGCGCCTGCCGGCTACCGTCGGCTCGG
CAATGAGTGCCTGCGCGTCGACCTGGCAGAGAAGCTTCTTCATGCCGCGCATCGCACCCGGCTCGGCACCAAGGCACGGC
GCGTGTTCTTGGATCCGGCTGTTGCGCGCTCGATGAACCTTTCAACGGCGGCCTATGCCGCCTTGCTGAGGGCGGGAGGC
TTTCGCGTGCACATGGGTCGCGCCCTGCCCGAAAGGGCATTCGGCCCACCGCAGCCGCCGCTGTGGGACTGGCGGCCATC
GCGCGCGACGACTGCATCTGACGCGCCACCACCGCCTCGTCCGCCCATCGGGGCCTTTGCCGCGCTGGCCGACCTGGTCG
GGCGTTAG

Upstream 100 bases:

>100_bases
CGGGTCGAGAGACAAGTAAAAGGCCCGGAGCGATCCGGGCCTTTTTCGTGTTGGCAAACGGCGGGGATAAAATTCCTGCG
GTCGCTTGTTTCAGACGATC

Downstream 100 bases:

>100_bases
CGAGGGAGAGCGCCCGGTTGCGGATCGACAAGTTCCTCTGGTTCACGCGTTTCGCCGGAACTCGCAATCTTGCGCAAGGT
TGGGTCGAGGACGGCCATAT

Product: helicase-like protein

Products: NA

Alternate protein names: Helicase Domain Protein; Helicase; Helicase-Like; Helicase Conserved C-Terminal Domain Protein; ATP-Dependent Helicase; ATP-Dependent RNA Helicase; ATP-Dependent DNA Helicase; DEAD/DEAH Box Helicase Domain-Containing Protein; Superfamily II DNA/RNA Helicase; MgpS ATP-Dependent Helicase; ATP-Dependent DNA Helicase Protein; RNA Helicase; Helicase-Like Protein; RNA Helicase RhrA; ATP-Dependent Helicase MgpS; ATP-Dependent RNA Helicase Superfamily II; Helicase C-Terminal Domain Protein; Superfamily II DNA And RNA Helicase; ATP-Dependent RNA And DNA Helicase; DNA Helicase; DEAD/DEAH Box Helicase Domain Protein; ATP Dependent RNA Helicase; ATP-Dependent DNA And RNA Helicase Protein; Adenosinetriphosphatase

Number of amino acids: Translated: 855; Mature: 854

Protein sequence:

>855_residues
MPATFPSMAQRIPAQPRKSAHTGVVKAVLGPTNTGKTHLAIERLCAHSSGAIGFPLRLLAREVYDRVCAIKGADNVALIT
GEERIEPKGARWHLCTVEAMPSRPDLAFVALDEAQLSADPERGHVFTDRLMHTRGREETMLLGSSTLEPMVKALVPEAEV
VTRPRFSTLTHVGAKKLSRIPPRSAIVAFSAEQVYVMAEMLRRFRGGAAVVMGALSPQTRNAQVAMYQAGEVDYLVATDA
IGMGLNLDVHHVAFAGLSKFDGHRQRRLTTAEMAQIAGRAGRHQRDGTFGALAGMGGHDPEFTPEEIYAIEEHRFAPLTR
LFWREAEPRFDSIATLIEDLESPPPRPELATPPQAIDLAVLKRLAEDVDIASGVRGQRSVQRFWDVCRLPDFRQQGYETH
SRFVARLWQDLRHGYLGADYVAQAIAQLDNPSGDIDTLQARIAAIRSWAYIAQRPDWVLAKDEMSARARAVEARLSDALH
ARLTERFVNRRTAVLMRKAGADAGLLPVRLGDEGAVLVDDEPIGHLEGFRFVVDPLARAEDRKLLLAAAERHLPGLLASR
ANVLVAAAGEPDGIEFEDTALVWQDTVVARIERGRHMLSPRIKPDLALDRLAPGCKAEVLAALDGWFAAQHKRHLAPILA
LDEASRDPASGPELRALLLHLVESGGVLPREQSGLDRLDPAQRDRLRKLGVRIGSLDLFLPAALRPAAMQAWHRLARIWS
RPLPLPPESMQPVVHAKIAPAGYRRLGNECLRVDLAEKLLHAAHRTRLGTKARRVFLDPAVARSMNLSTAAYAALLRAGG
FRVHMGRALPERAFGPPQPPLWDWRPSRATTASDAPPPPRPPIGAFAALADLVGR

Sequences:

>Translated_855_residues
MPATFPSMAQRIPAQPRKSAHTGVVKAVLGPTNTGKTHLAIERLCAHSSGAIGFPLRLLAREVYDRVCAIKGADNVALIT
GEERIEPKGARWHLCTVEAMPSRPDLAFVALDEAQLSADPERGHVFTDRLMHTRGREETMLLGSSTLEPMVKALVPEAEV
VTRPRFSTLTHVGAKKLSRIPPRSAIVAFSAEQVYVMAEMLRRFRGGAAVVMGALSPQTRNAQVAMYQAGEVDYLVATDA
IGMGLNLDVHHVAFAGLSKFDGHRQRRLTTAEMAQIAGRAGRHQRDGTFGALAGMGGHDPEFTPEEIYAIEEHRFAPLTR
LFWREAEPRFDSIATLIEDLESPPPRPELATPPQAIDLAVLKRLAEDVDIASGVRGQRSVQRFWDVCRLPDFRQQGYETH
SRFVARLWQDLRHGYLGADYVAQAIAQLDNPSGDIDTLQARIAAIRSWAYIAQRPDWVLAKDEMSARARAVEARLSDALH
ARLTERFVNRRTAVLMRKAGADAGLLPVRLGDEGAVLVDDEPIGHLEGFRFVVDPLARAEDRKLLLAAAERHLPGLLASR
ANVLVAAAGEPDGIEFEDTALVWQDTVVARIERGRHMLSPRIKPDLALDRLAPGCKAEVLAALDGWFAAQHKRHLAPILA
LDEASRDPASGPELRALLLHLVESGGVLPREQSGLDRLDPAQRDRLRKLGVRIGSLDLFLPAALRPAAMQAWHRLARIWS
RPLPLPPESMQPVVHAKIAPAGYRRLGNECLRVDLAEKLLHAAHRTRLGTKARRVFLDPAVARSMNLSTAAYAALLRAGG
FRVHMGRALPERAFGPPQPPLWDWRPSRATTASDAPPPPRPPIGAFAALADLVGR
>Mature_854_residues
PATFPSMAQRIPAQPRKSAHTGVVKAVLGPTNTGKTHLAIERLCAHSSGAIGFPLRLLAREVYDRVCAIKGADNVALITG
EERIEPKGARWHLCTVEAMPSRPDLAFVALDEAQLSADPERGHVFTDRLMHTRGREETMLLGSSTLEPMVKALVPEAEVV
TRPRFSTLTHVGAKKLSRIPPRSAIVAFSAEQVYVMAEMLRRFRGGAAVVMGALSPQTRNAQVAMYQAGEVDYLVATDAI
GMGLNLDVHHVAFAGLSKFDGHRQRRLTTAEMAQIAGRAGRHQRDGTFGALAGMGGHDPEFTPEEIYAIEEHRFAPLTRL
FWREAEPRFDSIATLIEDLESPPPRPELATPPQAIDLAVLKRLAEDVDIASGVRGQRSVQRFWDVCRLPDFRQQGYETHS
RFVARLWQDLRHGYLGADYVAQAIAQLDNPSGDIDTLQARIAAIRSWAYIAQRPDWVLAKDEMSARARAVEARLSDALHA
RLTERFVNRRTAVLMRKAGADAGLLPVRLGDEGAVLVDDEPIGHLEGFRFVVDPLARAEDRKLLLAAAERHLPGLLASRA
NVLVAAAGEPDGIEFEDTALVWQDTVVARIERGRHMLSPRIKPDLALDRLAPGCKAEVLAALDGWFAAQHKRHLAPILAL
DEASRDPASGPELRALLLHLVESGGVLPREQSGLDRLDPAQRDRLRKLGVRIGSLDLFLPAALRPAAMQAWHRLARIWSR
PLPLPPESMQPVVHAKIAPAGYRRLGNECLRVDLAEKLLHAAHRTRLGTKARRVFLDPAVARSMNLSTAAYAALLRAGGF
RVHMGRALPERAFGPPQPPLWDWRPSRATTASDAPPPPRPPIGAFAALADLVGR

Specific function: Unknown

COG id: COG0513

COG function: function code LKJ; Superfamily II DNA and RNA helicases

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

Organism=Homo sapiens, GI31543667, Length=288, Percent_Identity=34.375, Blast_Score=122, Evalue=2e-27,
Organism=Caenorhabditis elegans, GI115532782, Length=281, Percent_Identity=32.0284697508897, Blast_Score=108, Evalue=8e-24,
Organism=Caenorhabditis elegans, GI115532784, Length=264, Percent_Identity=32.9545454545455, Blast_Score=108, Evalue=9e-24,
Organism=Saccharomyces cerevisiae, GI6325228, Length=269, Percent_Identity=35.3159851301115, Blast_Score=143, Evalue=1e-34,
Organism=Drosophila melanogaster, GI221329989, Length=307, Percent_Identity=31.9218241042345, Blast_Score=119, Evalue=7e-27,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 93816; Mature: 93685

Theoretical pI: Translated: 9.77; Mature: 9.77

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.7 %Cys     (Translated Protein)
2.3 %Met     (Translated Protein)
3.0 %Cys+Met (Translated Protein)
0.7 %Cys     (Mature Protein)
2.2 %Met     (Mature Protein)
2.9 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MPATFPSMAQRIPAQPRKSAHTGVVKAVLGPTNTGKTHLAIERLCAHSSGAIGFPLRLLA
CCCCCHHHHHHCCCCCCCCHHHHHHHHHCCCCCCCCHHHHHHHHHHCCCCCCCHHHHHHH
REVYDRVCAIKGADNVALITGEERIEPKGARWHLCTVEAMPSRPDLAFVALDEAQLSADP
HHHHHHHHHCCCCCCEEEEECCHHCCCCCCEEEEEEEEECCCCCCEEEEEECCHHHCCCC
ERGHVFTDRLMHTRGREETMLLGSSTLEPMVKALVPEAEVVTRPRFSTLTHVGAKKLSRI
CCCCHHHHHHHHHCCCCCEEEECCHHHHHHHHHHCCCHHHHCCCCHHHHHHHHHHHHHCC
PPRSAIVAFSAEQVYVMAEMLRRFRGGAAVVMGALSPQTRNAQVAMYQAGEVDYLVATDA
CCCCEEEEECCHHHHHHHHHHHHHCCCCEEEEECCCCCCCCCEEEEEECCCEEEEEEECC
IGMGLNLDVHHVAFAGLSKFDGHRQRRLTTAEMAQIAGRAGRHQRDGTFGALAGMGGHDP
CCCCCCCCHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHCCCCCCCCCHHHHCCCCCCCC
EFTPEEIYAIEEHRFAPLTRLFWREAEPRFDSIATLIEDLESPPPRPELATPPQAIDLAV
CCCHHHHHHHHHHCCCHHHHHHHHCCCCCHHHHHHHHHHHCCCCCCCCCCCCCHHHHHHH
LKRLAEDVDIASGVRGQRSVQRFWDVCRLPDFRQQGYETHSRFVARLWQDLRHGYLGADY
HHHHHHHHHHHCCCCHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHCCCCCHHH
VAQAIAQLDNPSGDIDTLQARIAAIRSWAYIAQRPDWVLAKDEMSARARAVEARLSDALH
HHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHCCCCEEEECHHHHHHHHHHHHHHHHHHH
ARLTERFVNRRTAVLMRKAGADAGLLPVRLGDEGAVLVDDEPIGHLEGFRFVVDPLARAE
HHHHHHHHHHHHHHHHHHCCCCCCEEEEEECCCCEEEECCCCCCCCCCHHHHHHHHHCCC
DRKLLLAAAERHLPGLLASRANVLVAAAGEPDGIEFEDTALVWQDTVVARIERGRHMLSP
CCHHHHHHHHHHCCHHHHCCCCEEEEECCCCCCCCCCCCEEEHHHHHHHHHHHCHHHCCC
RIKPDLALDRLAPGCKAEVLAALDGWFAAQHKRHLAPILALDEASRDPASGPELRALLLH
CCCCCHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHCHHHEECCCCCCCCCCHHHHHHHHH
LVESGGVLPREQSGLDRLDPAQRDRLRKLGVRIGSLDLFLPAALRPAAMQAWHRLARIWS
HHHCCCCCCCCCCCCCCCCHHHHHHHHHHHCEECCCHHHHHHHCCHHHHHHHHHHHHHHC
RPLPLPPESMQPVVHAKIAPAGYRRLGNECLRVDLAEKLLHAAHRTRLGTKARRVFLDPA
CCCCCCCCCCCCHHHEECCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHCHHHHHHEECHH
VARSMNLSTAAYAALLRAGGFRVHMGRALPERAFGPPQPPLWDWRPSRATTASDAPPPPR
HHHHCCCHHHHHHHHHHCCCCEEECCCCCCHHCCCCCCCCCCCCCCCCCCCCCCCCCCCC
PPIGAFAALADLVGR
CCHHHHHHHHHHHCC
>Mature Secondary Structure 
PATFPSMAQRIPAQPRKSAHTGVVKAVLGPTNTGKTHLAIERLCAHSSGAIGFPLRLLA
CCCCHHHHHHCCCCCCCCHHHHHHHHHCCCCCCCCHHHHHHHHHHCCCCCCCHHHHHHH
REVYDRVCAIKGADNVALITGEERIEPKGARWHLCTVEAMPSRPDLAFVALDEAQLSADP
HHHHHHHHHCCCCCCEEEEECCHHCCCCCCEEEEEEEEECCCCCCEEEEEECCHHHCCCC
ERGHVFTDRLMHTRGREETMLLGSSTLEPMVKALVPEAEVVTRPRFSTLTHVGAKKLSRI
CCCCHHHHHHHHHCCCCCEEEECCHHHHHHHHHHCCCHHHHCCCCHHHHHHHHHHHHHCC
PPRSAIVAFSAEQVYVMAEMLRRFRGGAAVVMGALSPQTRNAQVAMYQAGEVDYLVATDA
CCCCEEEEECCHHHHHHHHHHHHHCCCCEEEEECCCCCCCCCEEEEEECCCEEEEEEECC
IGMGLNLDVHHVAFAGLSKFDGHRQRRLTTAEMAQIAGRAGRHQRDGTFGALAGMGGHDP
CCCCCCCCHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHCCCCCCCCCHHHHCCCCCCCC
EFTPEEIYAIEEHRFAPLTRLFWREAEPRFDSIATLIEDLESPPPRPELATPPQAIDLAV
CCCHHHHHHHHHHCCCHHHHHHHHCCCCCHHHHHHHHHHHCCCCCCCCCCCCCHHHHHHH
LKRLAEDVDIASGVRGQRSVQRFWDVCRLPDFRQQGYETHSRFVARLWQDLRHGYLGADY
HHHHHHHHHHHCCCCHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHCCCCCHHH
VAQAIAQLDNPSGDIDTLQARIAAIRSWAYIAQRPDWVLAKDEMSARARAVEARLSDALH
HHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHCCCCEEEECHHHHHHHHHHHHHHHHHHH
ARLTERFVNRRTAVLMRKAGADAGLLPVRLGDEGAVLVDDEPIGHLEGFRFVVDPLARAE
HHHHHHHHHHHHHHHHHHCCCCCCEEEEEECCCCEEEECCCCCCCCCCHHHHHHHHHCCC
DRKLLLAAAERHLPGLLASRANVLVAAAGEPDGIEFEDTALVWQDTVVARIERGRHMLSP
CCHHHHHHHHHHCCHHHHCCCCEEEEECCCCCCCCCCCCEEEHHHHHHHHHHHCHHHCCC
RIKPDLALDRLAPGCKAEVLAALDGWFAAQHKRHLAPILALDEASRDPASGPELRALLLH
CCCCCHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHCHHHEECCCCCCCCCCHHHHHHHHH
LVESGGVLPREQSGLDRLDPAQRDRLRKLGVRIGSLDLFLPAALRPAAMQAWHRLARIWS
HHHCCCCCCCCCCCCCCCCHHHHHHHHHHHCEECCCHHHHHHHCCHHHHHHHHHHHHHHC
RPLPLPPESMQPVVHAKIAPAGYRRLGNECLRVDLAEKLLHAAHRTRLGTKARRVFLDPA
CCCCCCCCCCCCHHHEECCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHCHHHHHHEECHH
VARSMNLSTAAYAALLRAGGFRVHMGRALPERAFGPPQPPLWDWRPSRATTASDAPPPPR
HHHHCCCHHHHHHHHHHCCCCEEECCCCCCHHCCCCCCCCCCCCCCCCCCCCCCCCCCCC
PPIGAFAALADLVGR
CCHHHHHHHHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA