| Definition | Burkholderia pseudomallei K96243 chromosome 2, complete sequence. |
|---|---|
| Accession | NC_006351 |
| Length | 3,173,005 |
Click here to switch to the map view.
The map label for this gene is thcB [H]
Identifier: 53722675
GI number: 53722675
Start: 2272681
End: 2275035
Strand: Reverse
Name: thcB [H]
Synonym: BPSS1654
Alternate gene names: 53722675
Gene position: 2275035-2272681 (Counterclockwise)
Preceding gene: 53722683
Following gene: 53722674
Centisome position: 71.7
GC content: 70.15
Gene sequence:
>2355_bases ATGACGACGCATTCCGCGTCCACGCCGCCGGCCTTGCCCGCCGCGCAGTGTCCGTTCCGCCCCGTTTCAGACGATGCCGC CGCGCATCCGGCCCGTTGCCCGGCGAGCGCCGGGGCGGCGGCATTCGATCCGTTCGACGACGCCTATCAACAGGACCCGC CCGAGTACGTGCGTTGGGCGCGCGAGCGCGAGCCGGTGTTCTACAGCCCGAAGCTCGGTTACTGGGTCGTCGCGCGCTAT GACGACATCAAGACGATCTTTCGCGACAACCGGACCTTCAGCCCGTCGATCGCGCTCGAGAAGATCACGCCGACGGGGCC GGACGCGAACGCGGCGCTCGCGTCGTACGGCTATGCGATGGGCCGCACGCTCGTCAACGAGGACGAGCCCACGCACATGG CGCGGCGGCGTCTGCTGATCGAGCCGTTCACGCCCGACGCGCTGCGCGCGCATGAGCCGATGGTGCGACGGCTTGCGCGC GAATACGTCGACCGCTTCGTCGACGATGGCCGCGCGGACCTCGTCGACCAGATGCTGTGGGAAGTGCCGCTCACGGTCGC GCTGCATTTTCTGGGCGTGCCCGAAGCGGACATGGATACGCTGCGCGCGTACTCGATCGCGCATACCGTCAACACCTGGG GACGGCCGCGGCCGGACGAGCAAGTTGCGGTCGCGCATGCGGTCGGACAGTTCTGGCAGTACGCGGGCAAGGTGCTCGGG AAGATGCGGGAGGATCCGTCGGGGCCCGGCTGGATGCAGTTCGGCATCCGCATGCAGCGCGAGCATCCGGACATCGTCAC CGATTCGTATCTGCATTCGATGATGATGGCGGGCATCGTTGCCGCGCACGAGACCACCGCGAACGCAACGGCGAACGCGC TGAAGCTGTTGCTCGAGCATCCGCGCGCGTGGCGAGAGCTGTGTGACGACCCTGCGCTGATCCCGAACGCGGTCGACGAG TGCCTGCGTCACAGCGGATCGATCGTCGCGTGGCGGCGGATCGCGACGCGCGACGCGACGGTCGGCGGCGTTGCGATTCC CGCCGGCGCGAAGCTGTTGATCGTCACGTCGTCGGCGAATCGTGACGAGCGCCGCTTCGCCGATCCGGACCTGTTCGACA TCCACCGCGACAATCCCGCCGATCACCTGACGTTCGGCTACGGTTCGCATCAGTGCATGGGCAAGCATCTCGCGCGCATG GAGATGCAGATCTTCATCGACGAGCTGTCGCGCCGCCTGCCGCACATGCGGCTCGCCGAACAGCGCTTCACGTATGTGCC GAACACGTCGTTTCGTGGTCCGGAGCATCTGTGGGTCGAATGGGCGCCGGCGGAGAATCCGCAGCGGCGCGGCCACGGCG CGCGCCGCTGCGCGCTTGCCGTGCGCATCGGCGAATCGAACGCGCGCCGCGCGGGGCGCGCGCTGCGCGTCGACAGCGTG ATGCCGGTGGCCGAGCGCGTGCTGCGCGTACGCCTCGTCGCGCCCGACGGCGCGCCGCTGCCGCGCTGGAGCGCGGGCGC GCATATCGACGTTGAATGCGGCGACACCGGGCTCTCCCGACAGTACTCGCTGTGCGGCGATCCGGCCGAGCGCGGCGTAT ACGAGATCGCGGTGCTGCGCGAGCCGGCGAGCCGCGGCGGCTCCGCATGGCTGCACGAGCGGCTGCGGCCCGGCATGCGC GTAAAGATTCGCGGGCCGCGCAACCACTTCCGGCTCGACGGGCACGCCGCCCGCGCGATCCTGATCGCGGGCGGCATCGG CGTCACGCCGATCGGCGCGATCGCACGCGAGGCGCGCGCGCGCGGCATCGACTACGCGCTGCATTACTGCGGCCGCAGCC GCCGGACGATGGCGTTCGTCGACGAGCTCGCCGCGCTGCACGGCGAGCGGCTTCGCCTGCACGTGTCGGACGAAGGCACG CGGCATGATTTTTCCGCGCTCGACGTCGCTGCCGGCACGCAGGTGTATGCGTGCGGTCCCGCGCGCATGCTCGACGCGCT GGCCGCGTGCGCCGCGCATTGGCCGGCGCATGCGCTGCGCGTCGAGCATTTCGCGGCCGCCGCGCCGCGCGTCGATCCGC GCACCGATCAGCCGTTCGAGGTCGAGCTGAAGGATTCGGGGCTCACGCTGACGGTGCCCGCGAACCGGACGCTGCTGGCG ACGCTGCGCGCGGCGAACGTCGACGTGCAGAGCGACTGCGAGGAAGGGCTGTGCGGCTCGTGCGAGGTGCGCGTGCTTGC CGGCGAGGTTGACCATCGTGACAGCGTGCTGAGCGCGGACGAGCGTGCGCTGAACACGCGCATGATGGCGTGCTGCTCGC GCGCGAGGCGCGGACGGCTCGTGCTCGAACTGTAG
Upstream 100 bases:
>100_bases GGCGATGCAGGTTAACGCGATCATTGATTTTGCGCAGTGCGTACTAGCGTTACGCAAAGCGCAATTCGATCCAGCGTAAT TCGACCCCTGGAGGACTGCC
Downstream 100 bases:
>100_bases CTGTAGCGTGAGGCTCGTCGCCCCGGCGCGGGACGGACGAAGACAACGGCATGGCGGGAGGCGACGTATGACGGCGCGAG TGGACGTGCGCGCGAGGCTC
Product: cytochrome P450
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 784; Mature: 783
Protein sequence:
>784_residues MTTHSASTPPALPAAQCPFRPVSDDAAAHPARCPASAGAAAFDPFDDAYQQDPPEYVRWAREREPVFYSPKLGYWVVARY DDIKTIFRDNRTFSPSIALEKITPTGPDANAALASYGYAMGRTLVNEDEPTHMARRRLLIEPFTPDALRAHEPMVRRLAR EYVDRFVDDGRADLVDQMLWEVPLTVALHFLGVPEADMDTLRAYSIAHTVNTWGRPRPDEQVAVAHAVGQFWQYAGKVLG KMREDPSGPGWMQFGIRMQREHPDIVTDSYLHSMMMAGIVAAHETTANATANALKLLLEHPRAWRELCDDPALIPNAVDE CLRHSGSIVAWRRIATRDATVGGVAIPAGAKLLIVTSSANRDERRFADPDLFDIHRDNPADHLTFGYGSHQCMGKHLARM EMQIFIDELSRRLPHMRLAEQRFTYVPNTSFRGPEHLWVEWAPAENPQRRGHGARRCALAVRIGESNARRAGRALRVDSV MPVAERVLRVRLVAPDGAPLPRWSAGAHIDVECGDTGLSRQYSLCGDPAERGVYEIAVLREPASRGGSAWLHERLRPGMR VKIRGPRNHFRLDGHAARAILIAGGIGVTPIGAIAREARARGIDYALHYCGRSRRTMAFVDELAALHGERLRLHVSDEGT RHDFSALDVAAGTQVYACGPARMLDALAACAAHWPAHALRVEHFAAAAPRVDPRTDQPFEVELKDSGLTLTVPANRTLLA TLRAANVDVQSDCEEGLCGSCEVRVLAGEVDHRDSVLSADERALNTRMMACCSRARRGRLVLEL
Sequences:
>Translated_784_residues MTTHSASTPPALPAAQCPFRPVSDDAAAHPARCPASAGAAAFDPFDDAYQQDPPEYVRWAREREPVFYSPKLGYWVVARY DDIKTIFRDNRTFSPSIALEKITPTGPDANAALASYGYAMGRTLVNEDEPTHMARRRLLIEPFTPDALRAHEPMVRRLAR EYVDRFVDDGRADLVDQMLWEVPLTVALHFLGVPEADMDTLRAYSIAHTVNTWGRPRPDEQVAVAHAVGQFWQYAGKVLG KMREDPSGPGWMQFGIRMQREHPDIVTDSYLHSMMMAGIVAAHETTANATANALKLLLEHPRAWRELCDDPALIPNAVDE CLRHSGSIVAWRRIATRDATVGGVAIPAGAKLLIVTSSANRDERRFADPDLFDIHRDNPADHLTFGYGSHQCMGKHLARM EMQIFIDELSRRLPHMRLAEQRFTYVPNTSFRGPEHLWVEWAPAENPQRRGHGARRCALAVRIGESNARRAGRALRVDSV MPVAERVLRVRLVAPDGAPLPRWSAGAHIDVECGDTGLSRQYSLCGDPAERGVYEIAVLREPASRGGSAWLHERLRPGMR VKIRGPRNHFRLDGHAARAILIAGGIGVTPIGAIAREARARGIDYALHYCGRSRRTMAFVDELAALHGERLRLHVSDEGT RHDFSALDVAAGTQVYACGPARMLDALAACAAHWPAHALRVEHFAAAAPRVDPRTDQPFEVELKDSGLTLTVPANRTLLA TLRAANVDVQSDCEEGLCGSCEVRVLAGEVDHRDSVLSADERALNTRMMACCSRARRGRLVLEL >Mature_783_residues TTHSASTPPALPAAQCPFRPVSDDAAAHPARCPASAGAAAFDPFDDAYQQDPPEYVRWAREREPVFYSPKLGYWVVARYD DIKTIFRDNRTFSPSIALEKITPTGPDANAALASYGYAMGRTLVNEDEPTHMARRRLLIEPFTPDALRAHEPMVRRLARE YVDRFVDDGRADLVDQMLWEVPLTVALHFLGVPEADMDTLRAYSIAHTVNTWGRPRPDEQVAVAHAVGQFWQYAGKVLGK MREDPSGPGWMQFGIRMQREHPDIVTDSYLHSMMMAGIVAAHETTANATANALKLLLEHPRAWRELCDDPALIPNAVDEC LRHSGSIVAWRRIATRDATVGGVAIPAGAKLLIVTSSANRDERRFADPDLFDIHRDNPADHLTFGYGSHQCMGKHLARME MQIFIDELSRRLPHMRLAEQRFTYVPNTSFRGPEHLWVEWAPAENPQRRGHGARRCALAVRIGESNARRAGRALRVDSVM PVAERVLRVRLVAPDGAPLPRWSAGAHIDVECGDTGLSRQYSLCGDPAERGVYEIAVLREPASRGGSAWLHERLRPGMRV KIRGPRNHFRLDGHAARAILIAGGIGVTPIGAIAREARARGIDYALHYCGRSRRTMAFVDELAALHGERLRLHVSDEGTR HDFSALDVAAGTQVYACGPARMLDALAACAAHWPAHALRVEHFAAAAPRVDPRTDQPFEVELKDSGLTLTVPANRTLLAT LRAANVDVQSDCEEGLCGSCEVRVLAGEVDHRDSVLSADERALNTRMMACCSRARRGRLVLEL
Specific function: Degradation of thiocarbamate herbicides [H]
COG id: COG2124
COG function: function code Q; Cytochrome P450
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the cytochrome P450 family [H]
Homologues:
Organism=Escherichia coli, GI1788104, Length=320, Percent_Identity=40.3125, Blast_Score=221, Evalue=2e-58,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR001128 - InterPro: IPR002397 - InterPro: IPR017972 [H]
Pfam domain/function: PF00067 p450 [H]
EC number: 1.-.-.- [C]
Molecular weight: Translated: 86771; Mature: 86639
Theoretical pI: Translated: 7.42; Mature: 7.42
Prosite motif: PS00086 CYTOCHROME_P450 ; PS00197 2FE2S_FER_1 ; PS51085 2FE2S_FER_2
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
2.0 %Cys (Translated Protein) 2.8 %Met (Translated Protein) 4.8 %Cys+Met (Translated Protein) 2.0 %Cys (Mature Protein) 2.7 %Met (Mature Protein) 4.7 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MTTHSASTPPALPAAQCPFRPVSDDAAAHPARCPASAGAAAFDPFDDAYQQDPPEYVRWA CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHCCCHHHHHHH REREPVFYSPKLGYWVVARYDDIKTIFRDNRTFSPSIALEKITPTGPDANAALASYGYAM HHCCCEEECCCCCEEEEEEEHHHHHHHHCCCCCCCCEEEEECCCCCCCCCHHHHHHHHHH GRTLVNEDEPTHMARRRLLIEPFTPDALRAHEPMVRRLAREYVDRFVDDGRADLVDQMLW CCHHCCCCCHHHHHHHHHEECCCCCHHHHHCCHHHHHHHHHHHHHHHCCCHHHHHHHHHH EVPLTVALHFLGVPEADMDTLRAYSIAHTVNTWGRPRPDEQVAVAHAVGQFWQYAGKVLG HHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHHHH KMREDPSGPGWMQFGIRMQREHPDIVTDSYLHSMMMAGIVAAHETTANATANALKLLLEH HHHCCCCCCCCEEECEEEECCCCCCHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHC PRAWRELCDDPALIPNAVDECLRHSGSIVAWRRIATRDATVGGVAIPAGAKLLIVTSSAN CHHHHHHCCCCCCCHHHHHHHHHCCCCEEEEEHHHCCCCCCCCEEECCCCEEEEEECCCC RDERRFADPDLFDIHRDNPADHLTFGYGSHQCMGKHLARMEMQIFIDELSRRLPHMRLAE CCHHHCCCCCCEECCCCCCCCEEEECCCCHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHH QRFTYVPNTSFRGPEHLWVEWAPAENPQRRGHGARRCALAVRIGESNARRAGRALRVDSV HHHEECCCCCCCCCCEEEEEECCCCCHHHHCCCHHEEEEEEEECCCCHHHCCCEEEECHH MPVAERVLRVRLVAPDGAPLPRWSAGAHIDVECGDTGLSRQYSLCGDPAERGVYEIAVLR HHHHHHHHEEEEECCCCCCCCCCCCCCEEEEEECCCCCCCCCCCCCCHHHCCEEEEEEEE EPASRGGSAWLHERLRPGMRVKIRGPRNHFRLDGHAARAILIAGGIGVTPIGAIAREARA CCCCCCCHHHHHHHCCCCCEEEEECCCCCEEECCCCEEEEEEECCCCCCHHHHHHHHHHH RGIDYALHYCGRSRRTMAFVDELAALHGERLRLHVSDEGTRHDFSALDVAAGTQVYACGP CCHHHHHHHCCCCCCHHHHHHHHHHHCCCEEEEEECCCCCCCCCHHHHHCCCCEEEECCH ARMLDALAACAAHWPAHALRVEHFAAAAPRVDPRTDQPFEVELKDSGLTLTVPANRTLLA HHHHHHHHHHHHHCCHHHHHHHHHHHCCCCCCCCCCCCEEEEEECCCEEEEECCCCEEEE TLRAANVDVQSDCEEGLCGSCEVRVLAGEVDHRDSVLSADERALNTRMMACCSRARRGRL EHHHCCCCCHHHHHCCCCCCCEEEEEECCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCE VLEL EEEC >Mature Secondary Structure TTHSASTPPALPAAQCPFRPVSDDAAAHPARCPASAGAAAFDPFDDAYQQDPPEYVRWA CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHCCCHHHHHHH REREPVFYSPKLGYWVVARYDDIKTIFRDNRTFSPSIALEKITPTGPDANAALASYGYAM HHCCCEEECCCCCEEEEEEEHHHHHHHHCCCCCCCCEEEEECCCCCCCCCHHHHHHHHHH GRTLVNEDEPTHMARRRLLIEPFTPDALRAHEPMVRRLAREYVDRFVDDGRADLVDQMLW CCHHCCCCCHHHHHHHHHEECCCCCHHHHHCCHHHHHHHHHHHHHHHCCCHHHHHHHHHH EVPLTVALHFLGVPEADMDTLRAYSIAHTVNTWGRPRPDEQVAVAHAVGQFWQYAGKVLG HHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHHHH KMREDPSGPGWMQFGIRMQREHPDIVTDSYLHSMMMAGIVAAHETTANATANALKLLLEH HHHCCCCCCCCEEECEEEECCCCCCHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHC PRAWRELCDDPALIPNAVDECLRHSGSIVAWRRIATRDATVGGVAIPAGAKLLIVTSSAN CHHHHHHCCCCCCCHHHHHHHHHCCCCEEEEEHHHCCCCCCCCEEECCCCEEEEEECCCC RDERRFADPDLFDIHRDNPADHLTFGYGSHQCMGKHLARMEMQIFIDELSRRLPHMRLAE CCHHHCCCCCCEECCCCCCCCEEEECCCCHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHH QRFTYVPNTSFRGPEHLWVEWAPAENPQRRGHGARRCALAVRIGESNARRAGRALRVDSV HHHEECCCCCCCCCCEEEEEECCCCCHHHHCCCHHEEEEEEEECCCCHHHCCCEEEECHH MPVAERVLRVRLVAPDGAPLPRWSAGAHIDVECGDTGLSRQYSLCGDPAERGVYEIAVLR HHHHHHHHEEEEECCCCCCCCCCCCCCEEEEEECCCCCCCCCCCCCCHHHCCEEEEEEEE EPASRGGSAWLHERLRPGMRVKIRGPRNHFRLDGHAARAILIAGGIGVTPIGAIAREARA CCCCCCCHHHHHHHCCCCCEEEEECCCCCEEECCCCEEEEEEECCCCCCHHHHHHHHHHH RGIDYALHYCGRSRRTMAFVDELAALHGERLRLHVSDEGTRHDFSALDVAAGTQVYACGP CCHHHHHHHCCCCCCHHHHHHHHHHHCCCEEEEEECCCCCCCCCHHHHHCCCCEEEECCH ARMLDALAACAAHWPAHALRVEHFAAAAPRVDPRTDQPFEVELKDSGLTLTVPANRTLLA HHHHHHHHHHHHHCCHHHHHHHHHHHCCCCCCCCCCCCEEEEEECCCEEEEECCCCEEEE TLRAANVDVQSDCEEGLCGSCEVRVLAGEVDHRDSVLSADERALNTRMMACCSRARRGRL EHHHCCCCCHHHHHCCCCCCCEEEEEECCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCE VLEL EEEC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: FMN. [C]
Metal ions: Fe [C]
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 7836301 [H]