Definition Sphingopyxis alaskensis RB2256, complete genome.
Accession NC_008048
Length 3,345,170

Click here to switch to the map view.

The map label for this gene is 103485930

Identifier: 103485930

GI number: 103485930

Start: 444934

End: 446769

Strand: Reverse

Name: 103485930

Synonym: Sala_0437

Alternate gene names: NA

Gene position: 446769-444934 (Counterclockwise)

Preceding gene: 103485934

Following gene: 103485929

Centisome position: 13.36

GC content: 64.32

Gene sequence:

>1836_bases
ATGGAAAACCGAAGGAAACCTGCGTCTCTCGCCGCCACGCTCGACATAAACTGCGACTGCAAAGAATATGTGATCGACTA
TCTCGCCAAGAGCTTTCCTGTTCGTCTGATGGCGGTGTTCACCGACGAAAACGGCAATCCGCGCTCCGAGCCGATGACTG
ACGAGGATGGCGCACCTGTGCTGTGCCGCTCCGCGCTGGCCGCGCGCGACCGGATGATCGAACAGCTCTGCGCCCTGCCG
CCGATTGCTACTGCGCTCGATGCCATCATCGAACGGTTCGGCGTTGACCAGGTGGCGGAAGTCACCGGTCGCACACGTCG
GCTCATCGTCGGCCGCGACGGTCGCCAGAAACTCCAATCCCGCTCGCCGCGCGCCAATGTGGCCGAAACCCAGGCCTTTA
TGGACGGCGCGAAGCGCATCCTGGTGTTCTCCGATGCCGGGGGAACGGGGCGCAGCTACCATGCTGATCTTGCCGCCAGG
AACCAGGCCCGCCGGGTCCACTTTCTGCTCGAGCCGGGCTGGCGAGCTGACGCCGCGATCCAGGGGCTTGGCCGGACCAA
TCGCACCAATCAGGCATCAGCCCCGCTGTTCCGGCCCGTGACCACCGATGTGCGCGGCGAGCGGCGGTTCATTTCGACGA
TCGCCCGCCGCCTCGACAGCTTGGGCGCTCTGACGCGCGGGCAGCGCCAGACCGGTGGCCAGAACCTCTTCGATCCGGCC
GACAATCTCGAAAGCATCTACGCCAAGGAGGCGCTCCACCGCTGGTTCGGCCTCTTGTTCACAGGCAAGCTCGAAGCCGT
CAGCCTCGGGCGCTTTCAGGAGCTGACAGGTCTCCGGATCGAAGCGCCTGATGGTTCGATGGTCGATGACCTGCCGTCGA
TCCAGCGGTGGCTCAACCGCATTCTTGCGCTTCCCATCGCCCTGCAGAACGCGATCTTTGACGAGTTCATGGGGCTGGTC
GAAGCGCGCATCGATGCCGCCCGGCAGGCTGGCACCCTCGATCTCGGCTTGGAGACCATCGCGGTTGAGGACTTCACGGT
CCTGTCGGACACGCTGCTGCGCACAGATCCAGCATCGGGCGCGACGACCCATCTCCTCGAACTGGAAATCGCCAGGGCCC
TGAAGCCGCTCACGCTGACGCGGCTCGAGGAGATTCACGGCATCACCGGGCAGCGGCAACGCCCGGTTCGGAACGCCCGC
TCAGGTCGAGTCGCCTTACTGGTGCCCGCCCGAAGTATCCTTGCCGATGACGGTACGCGCGTGGCCCGCTTCGAATTGCT
TCGCCCGATGAAGCACAGCCACATCACCGAGGATCAGCTCGCTGAGAGCAGCTGGGAGGGGATCTCCGTCGACGTTTTCC
GCGAGGCCTGGGTCGCCGAGGTGGAAGAGGCCAGGACCAGCCACAAGCGCGAGCGCCTCTATCTCGCGACGGGCCTACTG
CTTCCGGTCTGGGACAAGCTCCCTTCGGATTTCGTCAGGGTTAGTCGCATCTCGGCGGCGGATGGCCGTTCGCTCCTTGG
CCGCGAGGTTCCCGCCCATTGTGTGCCCGAACTGTGCCGAGCGCTGGGTCTGGAACGCGAGCAAACGCTTTCCGCCGACG
ACATTGTCCAGACCGTCCTGGCAACGGGGAGGGCCATGGAGTTCACGGGCCGCGAGCTGCTCATGGTCAAGCGCAGCCTG
GTCAATGGGTCACAGCGACTTGAGCTTACGGGATGGAGTGCTGCTCGGCTCGACTGGTACAAGGCCCAAGGCTGCTTTAC
CGAGATCATCCGCTATCAGACCCGGCTCTTCGTACCGATCGAGGGCGCGGCGAGTGTGATTGCCAGACTGGCATGA

Upstream 100 bases:

>100_bases
CGGAGCCGGGCCGCTCGAAACGACAATAATGATCTTGATCGCATGTTGGTTCCTTCGACTTGTTCAGGTCGAGGGAACCG
TAATTATCTGGAGTGAAATC

Downstream 100 bases:

>100_bases
TCGGCAGGGGTTCCTTGCCAAATGGCATTATTTGCCATATATGATGCCATATGGAGAACTGCCATGCTGGCTCTGCAACC
CGTTGATACTGCCGTTACCG

Product: putative methylase/helicase

Products: NA

Alternate protein names: Probably Methylase/Helicase

Number of amino acids: Translated: 611; Mature: 611

Protein sequence:

>611_residues
MENRRKPASLAATLDINCDCKEYVIDYLAKSFPVRLMAVFTDENGNPRSEPMTDEDGAPVLCRSALAARDRMIEQLCALP
PIATALDAIIERFGVDQVAEVTGRTRRLIVGRDGRQKLQSRSPRANVAETQAFMDGAKRILVFSDAGGTGRSYHADLAAR
NQARRVHFLLEPGWRADAAIQGLGRTNRTNQASAPLFRPVTTDVRGERRFISTIARRLDSLGALTRGQRQTGGQNLFDPA
DNLESIYAKEALHRWFGLLFTGKLEAVSLGRFQELTGLRIEAPDGSMVDDLPSIQRWLNRILALPIALQNAIFDEFMGLV
EARIDAARQAGTLDLGLETIAVEDFTVLSDTLLRTDPASGATTHLLELEIARALKPLTLTRLEEIHGITGQRQRPVRNAR
SGRVALLVPARSILADDGTRVARFELLRPMKHSHITEDQLAESSWEGISVDVFREAWVAEVEEARTSHKRERLYLATGLL
LPVWDKLPSDFVRVSRISAADGRSLLGREVPAHCVPELCRALGLEREQTLSADDIVQTVLATGRAMEFTGRELLMVKRSL
VNGSQRLELTGWSAARLDWYKAQGCFTEIIRYQTRLFVPIEGAASVIARLA

Sequences:

>Translated_611_residues
MENRRKPASLAATLDINCDCKEYVIDYLAKSFPVRLMAVFTDENGNPRSEPMTDEDGAPVLCRSALAARDRMIEQLCALP
PIATALDAIIERFGVDQVAEVTGRTRRLIVGRDGRQKLQSRSPRANVAETQAFMDGAKRILVFSDAGGTGRSYHADLAAR
NQARRVHFLLEPGWRADAAIQGLGRTNRTNQASAPLFRPVTTDVRGERRFISTIARRLDSLGALTRGQRQTGGQNLFDPA
DNLESIYAKEALHRWFGLLFTGKLEAVSLGRFQELTGLRIEAPDGSMVDDLPSIQRWLNRILALPIALQNAIFDEFMGLV
EARIDAARQAGTLDLGLETIAVEDFTVLSDTLLRTDPASGATTHLLELEIARALKPLTLTRLEEIHGITGQRQRPVRNAR
SGRVALLVPARSILADDGTRVARFELLRPMKHSHITEDQLAESSWEGISVDVFREAWVAEVEEARTSHKRERLYLATGLL
LPVWDKLPSDFVRVSRISAADGRSLLGREVPAHCVPELCRALGLEREQTLSADDIVQTVLATGRAMEFTGRELLMVKRSL
VNGSQRLELTGWSAARLDWYKAQGCFTEIIRYQTRLFVPIEGAASVIARLA
>Mature_611_residues
MENRRKPASLAATLDINCDCKEYVIDYLAKSFPVRLMAVFTDENGNPRSEPMTDEDGAPVLCRSALAARDRMIEQLCALP
PIATALDAIIERFGVDQVAEVTGRTRRLIVGRDGRQKLQSRSPRANVAETQAFMDGAKRILVFSDAGGTGRSYHADLAAR
NQARRVHFLLEPGWRADAAIQGLGRTNRTNQASAPLFRPVTTDVRGERRFISTIARRLDSLGALTRGQRQTGGQNLFDPA
DNLESIYAKEALHRWFGLLFTGKLEAVSLGRFQELTGLRIEAPDGSMVDDLPSIQRWLNRILALPIALQNAIFDEFMGLV
EARIDAARQAGTLDLGLETIAVEDFTVLSDTLLRTDPASGATTHLLELEIARALKPLTLTRLEEIHGITGQRQRPVRNAR
SGRVALLVPARSILADDGTRVARFELLRPMKHSHITEDQLAESSWEGISVDVFREAWVAEVEEARTSHKRERLYLATGLL
LPVWDKLPSDFVRVSRISAADGRSLLGREVPAHCVPELCRALGLEREQTLSADDIVQTVLATGRAMEFTGRELLMVKRSL
VNGSQRLELTGWSAARLDWYKAQGCFTEIIRYQTRLFVPIEGAASVIARLA

Specific function: Unknown

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

Organism=Homo sapiens, GI269846812, Length=501, Percent_Identity=29.940119760479, Blast_Score=159, Evalue=5e-39,
Organism=Homo sapiens, GI269846807, Length=501, Percent_Identity=29.940119760479, Blast_Score=159, Evalue=7e-39,
Organism=Homo sapiens, GI154355002, Length=496, Percent_Identity=28.6290322580645, Blast_Score=135, Evalue=1e-31,
Organism=Homo sapiens, GI154355004, Length=496, Percent_Identity=28.6290322580645, Blast_Score=135, Evalue=1e-31,
Organism=Caenorhabditis elegans, GI17553078, Length=318, Percent_Identity=33.3333333333333, Blast_Score=139, Evalue=5e-33,
Organism=Drosophila melanogaster, GI161077796, Length=294, Percent_Identity=37.7551020408163, Blast_Score=159, Evalue=7e-39,
Organism=Drosophila melanogaster, GI24641704, Length=294, Percent_Identity=37.7551020408163, Blast_Score=159, Evalue=8e-39,
Organism=Drosophila melanogaster, GI161077794, Length=294, Percent_Identity=37.7551020408163, Blast_Score=158, Evalue=1e-38,
Organism=Drosophila melanogaster, GI19921354, Length=500, Percent_Identity=28.4, Blast_Score=151, Evalue=1e-36,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 67771; Mature: 67771

Theoretical pI: Translated: 8.08; Mature: 8.08

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.1 %Cys     (Translated Protein)
1.6 %Met     (Translated Protein)
2.8 %Cys+Met (Translated Protein)
1.1 %Cys     (Mature Protein)
1.6 %Met     (Mature Protein)
2.8 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MENRRKPASLAATLDINCDCKEYVIDYLAKSFPVRLMAVFTDENGNPRSEPMTDEDGAPV
CCCCCCCCCEEEEEECCCCHHHHHHHHHHHCCCEEEEEEEECCCCCCCCCCCCCCCCCCH
LCRSALAARDRMIEQLCALPPIATALDAIIERFGVDQVAEVTGRTRRLIVGRDGRQKLQS
HHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHCCHHHHHHCCCCEEEEEECCHHHHHHC
RSPRANVAETQAFMDGAKRILVFSDAGGTGRSYHADLAARNQARRVHFLLEPGWRADAAI
CCCCCCHHHHHHHHCCCCEEEEEECCCCCCCCEEHHHHHCCCCCEEEEEECCCCCCCHHH
QGLGRTNRTNQASAPLFRPVTTDVRGERRFISTIARRLDSLGALTRGQRQTGGQNLFDPA
HCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHCCCHHCCCCCCCCCH
DNLESIYAKEALHRWFGLLFTGKLEAVSLGRFQELTGLRIEAPDGSMVDDLPSIQRWLNR
HHHHHHHHHHHHHHHHHHHHCCCCHHHHCCCHHHHCCCEEECCCCCHHHHHHHHHHHHHH
ILALPIALQNAIFDEFMGLVEARIDAARQAGTLDLGLETIAVEDFTVLSDTLLRTDPASG
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCEEEEECCHHHHHHHHHCCCCCCC
ATTHLLELEIARALKPLTLTRLEEIHGITGQRQRPVRNARSGRVALLVPARSILADDGTR
CHHHHHHHHHHHHHCCHHHHHHHHHHCCCCCCCCCHHHCCCCCEEEEECCHHHHCCCCCH
VARFELLRPMKHSHITEDQLAESSWEGISVDVFREAWVAEVEEARTSHKRERLYLATGLL
HHHHHHHHHHHHCCCCHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHHHEEHHHHCCH
LPVWDKLPSDFVRVSRISAADGRSLLGREVPAHCVPELCRALGLEREQTLSADDIVQTVL
HHHHHHCCHHHHHHHHHCCCCCHHHHCCCCCHHHHHHHHHHHCCCHHHCCCHHHHHHHHH
ATGRAMEFTGRELLMVKRSLVNGSQRLELTGWSAARLDWYKAQGCFTEIIRYQTRLFVPI
HCCCCEECCCHHHHHHHHHHHCCCCEEEEECCCHHHHHHHHHHHHHHHHHHHHHEEEEEE
EGAASVIARLA
CHHHHHHHHCC
>Mature Secondary Structure
MENRRKPASLAATLDINCDCKEYVIDYLAKSFPVRLMAVFTDENGNPRSEPMTDEDGAPV
CCCCCCCCCEEEEEECCCCHHHHHHHHHHHCCCEEEEEEEECCCCCCCCCCCCCCCCCCH
LCRSALAARDRMIEQLCALPPIATALDAIIERFGVDQVAEVTGRTRRLIVGRDGRQKLQS
HHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHCCHHHHHHCCCCEEEEEECCHHHHHHC
RSPRANVAETQAFMDGAKRILVFSDAGGTGRSYHADLAARNQARRVHFLLEPGWRADAAI
CCCCCCHHHHHHHHCCCCEEEEEECCCCCCCCEEHHHHHCCCCCEEEEEECCCCCCCHHH
QGLGRTNRTNQASAPLFRPVTTDVRGERRFISTIARRLDSLGALTRGQRQTGGQNLFDPA
HCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHCCCHHCCCCCCCCCH
DNLESIYAKEALHRWFGLLFTGKLEAVSLGRFQELTGLRIEAPDGSMVDDLPSIQRWLNR
HHHHHHHHHHHHHHHHHHHHCCCCHHHHCCCHHHHCCCEEECCCCCHHHHHHHHHHHHHH
ILALPIALQNAIFDEFMGLVEARIDAARQAGTLDLGLETIAVEDFTVLSDTLLRTDPASG
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCEEEEECCHHHHHHHHHCCCCCCC
ATTHLLELEIARALKPLTLTRLEEIHGITGQRQRPVRNARSGRVALLVPARSILADDGTR
CHHHHHHHHHHHHHCCHHHHHHHHHHCCCCCCCCCHHHCCCCCEEEEECCHHHHCCCCCH
VARFELLRPMKHSHITEDQLAESSWEGISVDVFREAWVAEVEEARTSHKRERLYLATGLL
HHHHHHHHHHHHCCCCHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHHHEEHHHHCCH
LPVWDKLPSDFVRVSRISAADGRSLLGREVPAHCVPELCRALGLEREQTLSADDIVQTVL
HHHHHHCCHHHHHHHHHCCCCCHHHHCCCCCHHHHHHHHHHHCCCHHHCCCHHHHHHHHH
ATGRAMEFTGRELLMVKRSLVNGSQRLELTGWSAARLDWYKAQGCFTEIIRYQTRLFVPI
HCCCCEECCCHHHHHHHHHHHCCCCEEEEECCCHHHHHHHHHHHHHHHHHHHHHEEEEEE
EGAASVIARLA
CHHHHHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA