| Definition | Agrobacterium vitis S4 plasmid pAtS4e, complete sequence. |
|---|---|
| Accession | NC_011981 |
| Length | 631,775 |
Click here to switch to the map view.
The map label for this gene is soxC [H]
Identifier: 222102534
GI number: 222102534
Start: 130257
End: 131483
Strand: Direct
Name: soxC [H]
Synonym: Avi_7162
Alternate gene names: 222102534
Gene position: 130257-131483 (Clockwise)
Preceding gene: 222102533
Following gene: 222102535
Centisome position: 20.62
GC content: 57.05
Gene sequence:
>1227_bases ATGTCACAAATTGATCTAGGCTGGGGCGAGGGCCCTTCAGAGCGCTATGAAAGCCTTGCCGAAAAATTCCGCCCGATCTT CGCTGAAATTTCCACCGGTGCCATTGAACGCGAGCTCAACCGGACACTGCCCACCGAGCAAATCGCCAAGCTCAAGGCGG CTGGTTTCGCAGCCCTTCGGGTGCCGGAATCTGAAGGGGGTACAGGCGTAACACTGCCTGAACTGTTCAATCTGCTGATC GAGCTGTCTGCTGCGGATTCCAATATCACCCAGGCGCTGCGCGGTCATGTTGGCTTTGCCGAGGATGTGGTGAACAAGCT TGATGGCCCAGACCGCCGACGCTGGACGGAACGTCTGGTGCGGGGCGACCTTGTTGGAAACGCATGGACGGAAATTGGCA ACGCCCAACAGGCCAGCTTTTCAACCACCGTATCCAAGCGGGATGGTCAATTCGTCATCAACGGCCAGAAATATTACACA ACAGGTTCGCTGTTTGCCGACTGGATCAATGTGGGTGTCACCGGGCTTGATGGTGCCAGCAGCGCCGCGCAGGTCCGACG TGATGATCCGGGTGTCGAGGTTATTGATGATTGGAATGGCTTTGGCCAGACATTGACGGCAAGTGGCACAACGACATTCA CTGACGCCGCCGTTGATCCGTTAGACATCGTTGCCGATGACAATCAGTTTCGCTATGGCGCGGCTTTCTACCAAACAGTT CATCTCGCCACGCTTGCGGGCATTGGCCGCGCCATTGCCGACGAGACGGCTGCGGCCGTTGCCAAACGGGTGCGAAACTA CTCCAACGCCGCAGGCCCGCGTTCCAGCCAAGACCCGCAGGTGTTGCAGGTTGTCGGTCGCATCCGCAGCAATGCCTACA CGGCAACCGCAATTGTGTTGCAGGTGGCACGCGCCATCGAGAGGGCCTATCAGGCCCATTTCAGCGGTGATCGTGACGCC GAAGATCGTGCCAATATCATTGCAGAGCTGGAAACATCTCAAGCCCTGACGGTGGTGACCAACCTCATTCTTGAGGCCTC AACCATTATTTTCGATGCTCTTGGCGCATCGTCGACAAGCAAACCCATTGGTCTTGATCGCCATTGGCGCAACGCCCGCA CTTTGTCCTCTCACAATCCCCGGATCTACAAGGATCGCATTGTCGGTGATTTCGCCGTCAATGGCACGCCTCCGCCATTT CAATGGCGCATTGGGCTTGCTGGGTGA
Upstream 100 bases:
>100_bases CTCTGCTGAGCTGACTGCGCGCGATGATCTTCACCACATCTATCTCGGAGCGTCCGCTTAAATCCGGACACCAACAACGA CCAACAGGAAAAGCATCTTC
Downstream 100 bases:
>100_bases CGTTGATACGAAATACTTCAAAATTGAGTACAATATTCCCGCCAATAAACTACAAAAATATATATTTTCTATTCTTTAAG TATCCAATCCTTAAGATCGT
Product: thermophilic desulfurizing enzyme
Products: gamma-butyrobetaine; Acceptor; gamma-butyrobetainyl-CoA [C]
Alternate protein names: DBT sulfur dioxygenase [H]
Number of amino acids: Translated: 408; Mature: 407
Protein sequence:
>408_residues MSQIDLGWGEGPSERYESLAEKFRPIFAEISTGAIERELNRTLPTEQIAKLKAAGFAALRVPESEGGTGVTLPELFNLLI ELSAADSNITQALRGHVGFAEDVVNKLDGPDRRRWTERLVRGDLVGNAWTEIGNAQQASFSTTVSKRDGQFVINGQKYYT TGSLFADWINVGVTGLDGASSAAQVRRDDPGVEVIDDWNGFGQTLTASGTTTFTDAAVDPLDIVADDNQFRYGAAFYQTV HLATLAGIGRAIADETAAAVAKRVRNYSNAAGPRSSQDPQVLQVVGRIRSNAYTATAIVLQVARAIERAYQAHFSGDRDA EDRANIIAELETSQALTVVTNLILEASTIIFDALGASSTSKPIGLDRHWRNARTLSSHNPRIYKDRIVGDFAVNGTPPPF QWRIGLAG
Sequences:
>Translated_408_residues MSQIDLGWGEGPSERYESLAEKFRPIFAEISTGAIERELNRTLPTEQIAKLKAAGFAALRVPESEGGTGVTLPELFNLLI ELSAADSNITQALRGHVGFAEDVVNKLDGPDRRRWTERLVRGDLVGNAWTEIGNAQQASFSTTVSKRDGQFVINGQKYYT TGSLFADWINVGVTGLDGASSAAQVRRDDPGVEVIDDWNGFGQTLTASGTTTFTDAAVDPLDIVADDNQFRYGAAFYQTV HLATLAGIGRAIADETAAAVAKRVRNYSNAAGPRSSQDPQVLQVVGRIRSNAYTATAIVLQVARAIERAYQAHFSGDRDA EDRANIIAELETSQALTVVTNLILEASTIIFDALGASSTSKPIGLDRHWRNARTLSSHNPRIYKDRIVGDFAVNGTPPPF QWRIGLAG >Mature_407_residues SQIDLGWGEGPSERYESLAEKFRPIFAEISTGAIERELNRTLPTEQIAKLKAAGFAALRVPESEGGTGVTLPELFNLLIE LSAADSNITQALRGHVGFAEDVVNKLDGPDRRRWTERLVRGDLVGNAWTEIGNAQQASFSTTVSKRDGQFVINGQKYYTT GSLFADWINVGVTGLDGASSAAQVRRDDPGVEVIDDWNGFGQTLTASGTTTFTDAAVDPLDIVADDNQFRYGAAFYQTVH LATLAGIGRAIADETAAAVAKRVRNYSNAAGPRSSQDPQVLQVVGRIRSNAYTATAIVLQVARAIERAYQAHFSGDRDAE DRANIIAELETSQALTVVTNLILEASTIIFDALGASSTSKPIGLDRHWRNARTLSSHNPRIYKDRIVGDFAVNGTPPPFQ WRIGLAG
Specific function: Part of a pathway to remove covalently bound sulfur from dibenzothiophene (DBT) without breaking carbon-carbon bonds. Sulfur dioxygenase which converts DBT to DBT-sulfone (DBTO2 or DBT 5,5-dioxide) [H]
COG id: NA
COG function: NA
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: NA
Homologues:
None
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR013107 - InterPro: IPR006092 - InterPro: IPR006091 - InterPro: IPR009075 - InterPro: IPR013786 - InterPro: IPR009100 [H]
Pfam domain/function: PF08028 Acyl-CoA_dh_2; PF02770 Acyl-CoA_dh_M; PF02771 Acyl-CoA_dh_N [H]
EC number: 1.3.99.- [C]
Molecular weight: Translated: 44097; Mature: 43965
Theoretical pI: Translated: 5.04; Mature: 5.04
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.0 %Cys (Translated Protein) 0.2 %Met (Translated Protein) 0.2 %Cys+Met (Translated Protein) 0.0 %Cys (Mature Protein) 0.0 %Met (Mature Protein) 0.0 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MSQIDLGWGEGPSERYESLAEKFRPIFAEISTGAIERELNRTLPTEQIAKLKAAGFAALR CCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHCCEEEEE VPESEGGTGVTLPELFNLLIELSAADSNITQALRGHVGFAEDVVNKLDGPDRRRWTERLV CCCCCCCCCCCHHHHHHHHHHHCCCCHHHHHHHHHCCCHHHHHHHHCCCCHHHHHHHHHH RGDLVGNAWTEIGNAQQASFSTTVSKRDGQFVINGQKYYTTGSLFADWINVGVTGLDGAS HHHHCCHHHHHCCCCCHHHHHHHHCCCCCEEEECCCEEEECHHHHHHHHHCCCCCCCCCC SAAQVRRDDPGVEVIDDWNGFGQTLTASGTTTFTDAAVDPLDIVADDNQFRYGAAFYQTV HHHHHHCCCCCCEEEECCCCCCCEEECCCCCEECCCCCCCEEEEECCCCCCHHHHHHHHH HLATLAGIGRAIADETAAAVAKRVRNYSNAAGPRSSQDPQVLQVVGRIRSNAYTATAIVL HHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHCCCHHHHHHHH QVARAIERAYQAHFSGDRDAEDRANIIAELETSQALTVVTNLILEASTIIFDALGASSTS HHHHHHHHHHHHHCCCCCCCHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHCCCCCC KPIGLDRHWRNARTLSSHNPRIYKDRIVGDFAVNGTPPPFQWRIGLAG CCCCCCHHHCCCCCCCCCCCCEEHHHEEEEEEECCCCCCCEEEECCCC >Mature Secondary Structure SQIDLGWGEGPSERYESLAEKFRPIFAEISTGAIERELNRTLPTEQIAKLKAAGFAALR CCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHCCEEEEE VPESEGGTGVTLPELFNLLIELSAADSNITQALRGHVGFAEDVVNKLDGPDRRRWTERLV CCCCCCCCCCCHHHHHHHHHHHCCCCHHHHHHHHHCCCHHHHHHHHCCCCHHHHHHHHHH RGDLVGNAWTEIGNAQQASFSTTVSKRDGQFVINGQKYYTTGSLFADWINVGVTGLDGAS HHHHCCHHHHHCCCCCHHHHHHHHCCCCCEEEECCCEEEECHHHHHHHHHCCCCCCCCCC SAAQVRRDDPGVEVIDDWNGFGQTLTASGTTTFTDAAVDPLDIVADDNQFRYGAAFYQTV HHHHHHCCCCCCEEEECCCCCCCEEECCCCCEECCCCCCCEEEEECCCCCCHHHHHHHHH HLATLAGIGRAIADETAAAVAKRVRNYSNAAGPRSSQDPQVLQVVGRIRSNAYTATAIVL HHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHCCCHHHHHHHH QVARAIERAYQAHFSGDRDAEDRANIIAELETSQALTVVTNLILEASTIIFDALGASSTS HHHHHHHHHHHHHCCCCCCCHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHCCCCCC KPIGLDRHWRNARTLSSHNPRIYKDRIVGDFAVNGTPPPFQWRIGLAG CCCCCCHHHCCCCCCCCCCCCEEHHHEEEEEEECCCCCCCEEEECCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: crotono-betaine; reduced acceptor; crotonobetainyl-CoA [C]
Specific reaction: reduced acceptor + crotono-betaine = Acceptor + gamma-butyrobetaine reduced acceptor + crotonobetainyl-CoA = Acceptor + gamma-butyrobetainyl-CoA [C]
General reaction: Oxidoreductases; Acting on the CH-CH group of donors; With other acceptors [C]
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 7961424; 7574582 [H]