Definition Frankia sp. EAN1pec chromosome, complete genome.
Accession NC_009921
Length 8,982,042

Click here to switch to the map view.

The map label for this gene is tfdA [H]

Identifier: 158318829

GI number: 158318829

Start: 8675281

End: 8676117

Strand: Direct

Name: tfdA [H]

Synonym: Franean1_7105

Alternate gene names: 158318829

Gene position: 8675281-8676117 (Clockwise)

Preceding gene: 158318828

Following gene: 158318830

Centisome position: 96.58

GC content: 67.62

Gene sequence:

>837_bases
ATGTCCGTCACTGTCACACCTCTCGGCCCCCACCTGGGCGTGGAGATCACCGGCATGTCCGGTGGTGATCTACCCACCAC
GGCAGCCGCCGCCGCGTGCCTGGAGACCCTGGCGCGGCACGGTGTCGTCATCTACCGGGAAGCTCACATCAGCGACAGTG
ACCTGGTCTCTTTCAGCAGGCTCCTCGGTCGGGTCGTTCTGAACCCGACCGGCGAACACGAGCGCGCCGAGATCGCCACC
ATCACCCTGGATCCAGCGAAGACCGATGCGACCCTCGCGTGGTACCGCAAAGGCAATTTCCTCTGGCACATCGACGGAGC
CACCGACCAGCTACCGCAGAAAGCGACGCTGCTGACGGCACGCGAGGTGGACGAAACCGGCGGCGACACCGAGTTCGCCA
GCACATACGCCGCCTACGAGGCCCTACCCGATACCGAGAAGGTGGCGCTTGCCGAACATCACGTGCTGCACAGCTTCGCC
GCCGCGCAGAGACGCGCCCACCCCGATGCCACGGACGAACAGCAGGCCGACTGGGGCCGCGTGCCCACGCGGAAGCACCC
CCTCGTCTGGACCCGGGGCAACGGCCGCAGATCGCTCCTCCTCGGCGCGACCGCTGGTGAAGTAGTCGGTCTGCCGCCAG
CGGAGGGCGAGGCGCTACTGCAGCGCCTGCTCGAATGGTCGACCCAGCCACAATTCGTCCTGCGGCATCGCTGGCGCGCC
GGCGACCTGGTGATCTGGGACAACACCGGCATGCTGCACCGGGCTCTGCCGTTCGCCGCCACATCACGCCGGCTCATGCA
TCGGACGACGCTTGTGGGCGAGGAGGCCGTTGCGTGA

Upstream 100 bases:

>100_bases
GGCTGCCGCGTTCTGGTGTGTCCGCGATATCCCTGCTGTACAGTCGTACCTACTCTAGGTACGACTGTACAGCGACATAC
TGCGGAAGCCTGGGAGCGTC

Downstream 100 bases:

>100_bases
ACCGCGTGCCTCGACAGCGCTCGAACGCCGCGTGATCCGTCCACGTGATCGACGCCATGAACTGGTCGGACGAGGGCAGC
GTGACGCTGGCACCGCACGG

Product: taurine catabolism dioxygenase TauD/TfdA

Products: Aminoacetaldehyde; CO2; H+; Sulfite; Succinate [C]

Alternate protein names: 2,4-D dioxygenase [H]

Number of amino acids: Translated: 278; Mature: 277

Protein sequence:

>278_residues
MSVTVTPLGPHLGVEITGMSGGDLPTTAAAAACLETLARHGVVIYREAHISDSDLVSFSRLLGRVVLNPTGEHERAEIAT
ITLDPAKTDATLAWYRKGNFLWHIDGATDQLPQKATLLTAREVDETGGDTEFASTYAAYEALPDTEKVALAEHHVLHSFA
AAQRRAHPDATDEQQADWGRVPTRKHPLVWTRGNGRRSLLLGATAGEVVGLPPAEGEALLQRLLEWSTQPQFVLRHRWRA
GDLVIWDNTGMLHRALPFAATSRRLMHRTTLVGEEAVA

Sequences:

>Translated_278_residues
MSVTVTPLGPHLGVEITGMSGGDLPTTAAAAACLETLARHGVVIYREAHISDSDLVSFSRLLGRVVLNPTGEHERAEIAT
ITLDPAKTDATLAWYRKGNFLWHIDGATDQLPQKATLLTAREVDETGGDTEFASTYAAYEALPDTEKVALAEHHVLHSFA
AAQRRAHPDATDEQQADWGRVPTRKHPLVWTRGNGRRSLLLGATAGEVVGLPPAEGEALLQRLLEWSTQPQFVLRHRWRA
GDLVIWDNTGMLHRALPFAATSRRLMHRTTLVGEEAVA
>Mature_277_residues
SVTVTPLGPHLGVEITGMSGGDLPTTAAAAACLETLARHGVVIYREAHISDSDLVSFSRLLGRVVLNPTGEHERAEIATI
TLDPAKTDATLAWYRKGNFLWHIDGATDQLPQKATLLTAREVDETGGDTEFASTYAAYEALPDTEKVALAEHHVLHSFAA
AQRRAHPDATDEQQADWGRVPTRKHPLVWTRGNGRRSLLLGATAGEVVGLPPAEGEALLQRLLEWSTQPQFVLRHRWRAG
DLVIWDNTGMLHRALPFAATSRRLMHRTTLVGEEAVA

Specific function: Involved in degradation of the herbicide 2,4- dichlorophenoxyacetic acid (2,4-D). Is also able to degrade 2- methyl-4-chlorophenoxyacetic acid and 3-chlorobenzoic acid [H]

COG id: COG2175

COG function: function code Q; Probable taurine catabolism dioxygenase

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the tfdA dioxygenase family [H]

Homologues:

Organism=Escherichia coli, GI1786565, Length=283, Percent_Identity=29.6819787985866, Blast_Score=115, Evalue=5e-27,
Organism=Saccharomyces cerevisiae, GI6322971, Length=266, Percent_Identity=28.9473684210526, Blast_Score=74, Evalue=2e-14,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR003819 [H]

Pfam domain/function: PF02668 TauD [H]

EC number: 1.14.11.17 [C]

Molecular weight: Translated: 30349; Mature: 30217

Theoretical pI: Translated: 6.45; Mature: 6.45

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.4 %Cys     (Translated Protein)
1.4 %Met     (Translated Protein)
1.8 %Cys+Met (Translated Protein)
0.4 %Cys     (Mature Protein)
1.1 %Met     (Mature Protein)
1.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSVTVTPLGPHLGVEITGMSGGDLPTTAAAAACLETLARHGVVIYREAHISDSDLVSFSR
CEEEEECCCCCCCEEEECCCCCCCCHHHHHHHHHHHHHHCCEEEEEECCCCCHHHHHHHH
LLGRVVLNPTGEHERAEIATITLDPAKTDATLAWYRKGNFLWHIDGATDQLPQKATLLTA
HHHHEEECCCCCCCCEEEEEEEECCCCCCCEEEEEECCCEEEEECCCCCCCCCHHHEEEH
REVDETGGDTEFASTYAAYEALPDTEKVALAEHHVLHSFAAAQRRAHPDATDEQQADWGR
HHHHCCCCCCHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCC
VPTRKHPLVWTRGNGRRSLLLGATAGEVVGLPPAEGEALLQRLLEWSTQPQFVLRHRWRA
CCCCCCCEEEECCCCCEEEEEECCCCCEEECCCCCHHHHHHHHHHHCCCCCHHHHHCCCC
GDLVIWDNTGMLHRALPFAATSRRLMHRTTLVGEEAVA
CCEEEECCCCCHHHHCCHHHHHHHHHHHHHHCCHHHCC
>Mature Secondary Structure 
SVTVTPLGPHLGVEITGMSGGDLPTTAAAAACLETLARHGVVIYREAHISDSDLVSFSR
EEEEECCCCCCCEEEECCCCCCCCHHHHHHHHHHHHHHCCEEEEEECCCCCHHHHHHHH
LLGRVVLNPTGEHERAEIATITLDPAKTDATLAWYRKGNFLWHIDGATDQLPQKATLLTA
HHHHEEECCCCCCCCEEEEEEEECCCCCCCEEEEEECCCEEEEECCCCCCCCCHHHEEEH
REVDETGGDTEFASTYAAYEALPDTEKVALAEHHVLHSFAAAQRRAHPDATDEQQADWGR
HHHHCCCCCCHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCC
VPTRKHPLVWTRGNGRRSLLLGATAGEVVGLPPAEGEALLQRLLEWSTQPQFVLRHRWRA
CCCCCCCEEEECCCCCEEEEEECCCCCEEECCCCCHHHHHHHHHHHCCCCCHHHHHCCCC
GDLVIWDNTGMLHRALPFAATSRRLMHRTTLVGEEAVA
CCEEEECCCCCHHHHCCHHHHHHHHHHHHHHCCHHHCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: Ascorbate. [C]

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: 2-Oxoglutarate; O2; Taurine [C]

Specific reaction: 2-Oxoglutarate + O2 + Taurine --> Aminoacetaldehyde + CO2 + H+ + Sulfite + Succinate [C]

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: 3036764; 10777523; 11457355; 11955067 [H]