Definition Desulfurococcus kamchatkensis 1221n chromosome, complete genome.
Accession NC_011766
Length 1,365,223

Click here to switch to the map view.

The map label for this gene is soxB [H]

Identifier: 218883521

GI number: 218883521

Start: 196807

End: 197937

Strand: Direct

Name: soxB [H]

Synonym: DKAM_0210

Alternate gene names: 218883521

Gene position: 196807-197937 (Clockwise)

Preceding gene: 218883520

Following gene: 218883530

Centisome position: 14.42

GC content: 44.47

Gene sequence:

>1131_bases
ATGAAGACGGACGTGTTAATTATTGGGGGCGGGGTAACCGGGTTATTCACCGCTGTAAGCCTTCTGGAGCAAGGGTGCAG
GAATATAGTGATTATAGAGAAATCATACATTGGTTCAGGCGGTACATTTAGATGTGCAACTGGGATAAGGGCGAGCTTCA
CTAGTAGGGAGCATGTTAACGTGATGAAGAGGGCTATAGACTTATGGCCCGAGTACGCTAGGAAACTAGGGTTTCTATAC
AGGAGGGATGGCTACCTATGGGTATTGACAAGGGAGAGGGACGTCGAGTTCTTCAAGCAGGTTGTCGAATTTCATCACTC
ACTCGGCGTACCTTCAAGAATGATTTCTCCTGAGGAAGTAAGGGAAATAGTTCCATCAATAAATACTAATGGAATACTTG
CAGCAGTATATGACCCCTTAGCTGGTAAGGCTCAAGTATTCAACGCGGTTTTAAACGCTGTCATTCATTTAAAACGAAAC
AATATTAATGTATATGAGGGTATGAGAGCCCTTAAAATCAGTGATGAAGGAAGTAGGATAGTTGTTGAAACAAATAAGGG
AAGGGTTGAGGCGGATAAGGTAATTGTTGCAGCCGGTAAAGACAGTGCTAACTTACTCAAAGGCCTCGGCGTTGAACTCC
CAATACATAATCTAGCCAAGCATGTCTTAATTACTGAGGCGTTTAAACCGGTTATTAAGCCGCTTATAATAGACTGGTCA
TCTTCGTCATATATTCTACAGGTATTCCACGGCAACATATACATTGGCTCGGATATACCTGAGAAGTACGATGAGCCGGC
TGTAAATAAATACATGTTTCTAGAGAAAGCCGCCAAAGTATGGACAAGGTATTTCCCGTGGTTGGGTGAAGTATATGTTC
TAAGGTATTGGACCGGGTACTATGATATGACGCCGGATCACCATCCAATAATAGGGCCCCTGGAGGAAAACGAGAACATA
CTTGTCGCAGCCGGGTTTAGCGGTCATGGATTCATGATGGCTCCAGCAGTCGCCGAGGCGCTCACACAGTATATTCTAGG
CGGGAAACCCACCATACCGGAGTTTGAGAATCTTAAACCTGATAGGTTTAAGAAGGGGAAGTTAATAAAGGAGATAGCGG
TGTTCGGCTAG

Upstream 100 bases:

>100_bases
TAGCGAGGAAGACTGGGAAAAGCTTCGATGAGGTCCTCATCCCCCGTAATAGACCCCCGATCTCTCCTGTGAAAGTGAAG
TACTTTATAGGTGATGAGAG

Downstream 100 bases:

>100_bases
TCCTCCACTATGATGGTGAGGGGGTCAGCGTCCTCCTATACCTAACTCCATCGCCTATAACCCAGTATTCGCCATCGCTT
CTTTTTTCAAGCTTGAAAAC

Product: FAD dependent oxidoreductase

Products: NA

Alternate protein names: Sarcosine oxidase subunit B [H]

Number of amino acids: Translated: 376; Mature: 376

Protein sequence:

>376_residues
MKTDVLIIGGGVTGLFTAVSLLEQGCRNIVIIEKSYIGSGGTFRCATGIRASFTSREHVNVMKRAIDLWPEYARKLGFLY
RRDGYLWVLTRERDVEFFKQVVEFHHSLGVPSRMISPEEVREIVPSINTNGILAAVYDPLAGKAQVFNAVLNAVIHLKRN
NINVYEGMRALKISDEGSRIVVETNKGRVEADKVIVAAGKDSANLLKGLGVELPIHNLAKHVLITEAFKPVIKPLIIDWS
SSSYILQVFHGNIYIGSDIPEKYDEPAVNKYMFLEKAAKVWTRYFPWLGEVYVLRYWTGYYDMTPDHHPIIGPLEENENI
LVAAGFSGHGFMMAPAVAEALTQYILGGKPTIPEFENLKPDRFKKGKLIKEIAVFG

Sequences:

>Translated_376_residues
MKTDVLIIGGGVTGLFTAVSLLEQGCRNIVIIEKSYIGSGGTFRCATGIRASFTSREHVNVMKRAIDLWPEYARKLGFLY
RRDGYLWVLTRERDVEFFKQVVEFHHSLGVPSRMISPEEVREIVPSINTNGILAAVYDPLAGKAQVFNAVLNAVIHLKRN
NINVYEGMRALKISDEGSRIVVETNKGRVEADKVIVAAGKDSANLLKGLGVELPIHNLAKHVLITEAFKPVIKPLIIDWS
SSSYILQVFHGNIYIGSDIPEKYDEPAVNKYMFLEKAAKVWTRYFPWLGEVYVLRYWTGYYDMTPDHHPIIGPLEENENI
LVAAGFSGHGFMMAPAVAEALTQYILGGKPTIPEFENLKPDRFKKGKLIKEIAVFG
>Mature_376_residues
MKTDVLIIGGGVTGLFTAVSLLEQGCRNIVIIEKSYIGSGGTFRCATGIRASFTSREHVNVMKRAIDLWPEYARKLGFLY
RRDGYLWVLTRERDVEFFKQVVEFHHSLGVPSRMISPEEVREIVPSINTNGILAAVYDPLAGKAQVFNAVLNAVIHLKRN
NINVYEGMRALKISDEGSRIVVETNKGRVEADKVIVAAGKDSANLLKGLGVELPIHNLAKHVLITEAFKPVIKPLIIDWS
SSSYILQVFHGNIYIGSDIPEKYDEPAVNKYMFLEKAAKVWTRYFPWLGEVYVLRYWTGYYDMTPDHHPIIGPLEENENI
LVAAGFSGHGFMMAPAVAEALTQYILGGKPTIPEFENLKPDRFKKGKLIKEIAVFG

Specific function: Catalyzes the oxidative demethylation of sarcosine to yield glycine, hydrogen peroxide and 5,10- methylenetetrahydrofolate [H]

COG id: COG0665

COG function: function code E; Glycine/D-amino acid oxidases (deaminating)

Gene ontology:

Cell location: Cytoplasm [H]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the soxB family [H]

Homologues:

Organism=Homo sapiens, GI24797151, Length=392, Percent_Identity=24.7448979591837, Blast_Score=99, Evalue=4e-21,
Organism=Homo sapiens, GI194306651, Length=377, Percent_Identity=22.5464190981432, Blast_Score=87, Evalue=2e-17,
Organism=Homo sapiens, GI197927446, Length=367, Percent_Identity=22.3433242506812, Blast_Score=86, Evalue=4e-17,
Organism=Homo sapiens, GI21361378, Length=367, Percent_Identity=22.3433242506812, Blast_Score=86, Evalue=4e-17,
Organism=Homo sapiens, GI8923708, Length=338, Percent_Identity=25.7396449704142, Blast_Score=81, Evalue=2e-15,
Organism=Caenorhabditis elegans, GI25147318, Length=396, Percent_Identity=25.2525252525253, Blast_Score=84, Evalue=1e-16,
Organism=Drosophila melanogaster, GI20130091, Length=398, Percent_Identity=23.3668341708543, Blast_Score=90, Evalue=3e-18,
Organism=Drosophila melanogaster, GI20129729, Length=389, Percent_Identity=22.879177377892, Blast_Score=85, Evalue=8e-17,
Organism=Drosophila melanogaster, GI17985989, Length=378, Percent_Identity=21.957671957672, Blast_Score=70, Evalue=2e-12,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR006076
- InterPro:   IPR006278 [H]

Pfam domain/function: PF01266 DAO [H]

EC number: =1.5.3.1 [H]

Molecular weight: Translated: 42099; Mature: 42099

Theoretical pI: Translated: 8.82; Mature: 8.82

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.5 %Cys     (Translated Protein)
2.1 %Met     (Translated Protein)
2.7 %Cys+Met (Translated Protein)
0.5 %Cys     (Mature Protein)
2.1 %Met     (Mature Protein)
2.7 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKTDVLIIGGGVTGLFTAVSLLEQGCRNIVIIEKSYIGSGGTFRCATGIRASFTSREHVN
CCCCEEEECCCHHHHHHHHHHHHHCCCEEEEEEECCCCCCCCEEEECCCCCCCCCHHHHH
VMKRAIDLWPEYARKLGFLYRRDGYLWVLTRERDVEFFKQVVEFHHSLGVPSRMISPEEV
HHHHHHHHHHHHHHHHCCEEEECCEEEEEECCCCHHHHHHHHHHHHHCCCCHHCCCHHHH
REIVPSINTNGILAAVYDPLAGKAQVFNAVLNAVIHLKRNNINVYEGMRALKISDEGSRI
HHHHCCCCCCCEEEEEECCCCCHHHHHHHHHHHHEEEECCCCCHHHCCEEEEECCCCCEE
VVETNKGRVEADKVIVAAGKDSANLLKGLGVELPIHNLAKHVLITEAFKPVIKPLIIDWS
EEECCCCCEEECEEEEEECCCHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHEEEECC
SSSYILQVFHGNIYIGSDIPEKYDEPAVNKYMFLEKAAKVWTRYFPWLGEVYVLRYWTGY
CCCEEEEEEECCEEECCCCCHHCCCCHHHHHHHHHHHHHHHHHHCCHHHHEEEEEEECCE
YDMTPDHHPIIGPLEENENILVAAGFSGHGFMMAPAVAEALTQYILGGKPTIPEFENLKP
ECCCCCCCCEECCCCCCCCEEEEECCCCCCCEEHHHHHHHHHHHHHCCCCCCCCHHCCCC
DRFKKGKLIKEIAVFG
CHHHCCHHHHHHHCCC
>Mature Secondary Structure
MKTDVLIIGGGVTGLFTAVSLLEQGCRNIVIIEKSYIGSGGTFRCATGIRASFTSREHVN
CCCCEEEECCCHHHHHHHHHHHHHCCCEEEEEEECCCCCCCCEEEECCCCCCCCCHHHHH
VMKRAIDLWPEYARKLGFLYRRDGYLWVLTRERDVEFFKQVVEFHHSLGVPSRMISPEEV
HHHHHHHHHHHHHHHHCCEEEECCEEEEEECCCCHHHHHHHHHHHHHCCCCHHCCCHHHH
REIVPSINTNGILAAVYDPLAGKAQVFNAVLNAVIHLKRNNINVYEGMRALKISDEGSRI
HHHHCCCCCCCEEEEEECCCCCHHHHHHHHHHHHEEEECCCCCHHHCCEEEEECCCCCEE
VVETNKGRVEADKVIVAAGKDSANLLKGLGVELPIHNLAKHVLITEAFKPVIKPLIIDWS
EEECCCCCEEECEEEEEECCCHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHEEEECC
SSSYILQVFHGNIYIGSDIPEKYDEPAVNKYMFLEKAAKVWTRYFPWLGEVYVLRYWTGY
CCCEEEEEEECCEEECCCCCHHCCCCHHHHHHHHHHHHHHHHHHCCHHHHEEEEEEECCE
YDMTPDHHPIIGPLEENENILVAAGFSGHGFMMAPAVAEALTQYILGGKPTIPEFENLKP
ECCCCCCCCEECCCCCCCCEEEEECCCCCCCEEHHHHHHHHHHHHHCCCCCCCCHHCCCC
DRFKKGKLIKEIAVFG
CHHHCCHHHHHHHCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 7543100; 1939012; 3202887; 7692961 [H]