Definition Chlorobium tepidum TLS, complete genome.
Accession NC_002932
Length 2,154,946

Click here to switch to the map view.

The map label for this gene is pyrDI [H]

Identifier: 21674415

GI number: 21674415

Start: 1506471

End: 1507388

Strand: Direct

Name: pyrDI [H]

Synonym: CT1597

Alternate gene names: 21674415

Gene position: 1506471-1507388 (Clockwise)

Preceding gene: 21674414

Following gene: 21674418

Centisome position: 69.91

GC content: 59.37

Gene sequence:

>918_bases
ATGAACTCCCCTGCCGCCGTCAAACTCGGCAGGGGCCTCAACCTCCGCTCGCCGGTCATGCTCGCCTCCGGCACCGTTTC
TTACGGCGAAGAGCTTTCGCAACTGTGCGACCTTTCGAAAATCGGCGGTCTGGTCACCAAAGCCATTTCGCCCGAACCAA
GGACCGGCAATCCGCCGCAGCGCATCGCCGAAACATCCTGCGGCATGATCAACGCCATCGGATTGGCGAATGTCGGCCTC
GACAAGTTCGTTTCGGACAAGGTGCCATTTTTGCAGACACTCGACACACAGGTCATTGTCAACATCGCGGGCAAATCGAT
TGACGACTACTGCCAGGTGGTCGAACGGCTCGACACAGTCGAGGGCATCGCCGCTTACGAACTGAACCTTTCGTGCCCGA
ACGTCAAGGGCGAATGCATGATCATGGGGGTCAGCCCCGACGCAACCCGCGAAATTGTCTCCACGTTGCGCAAGCAGACC
AGGCGACACCTGATGGTGAAGCTCACGCCAAATGTCACATCGATCAGTGCGATTGCCCTCGCCGCCGAGGAGGCTGGCGC
GGACTCGGTCTCGCTCATCAATACCGTGGTCGGCATGGCGGTGGATTACCGCAAGCGCAAGCCGCTGCTGAAAAACGTGA
CCGGCGGCCTCTCCGGCCCGGCTATCAAGCCGATTGCGCTGGCCAAGGTGTGGGAGGTGTCAAAAGCCGTAAAGATTCCG
ATTGTCGGCATGGGCGGCATCGCCTCGTTCTCAGACGCGATGGAGTTCCTGCTCGTCGGAGCCAGCGCCATCCAGATCGG
CACCATGAACTTCGTCTATCCCGACATCGGCGAAAAGATCGCCGTGGCGATCGACAAATTCTTCTCGCAACCTGACGCTC
CGGCATTTCAGGAGTATGTCGGCAGCCTGATGGTTTAG

Upstream 100 bases:

>100_bases
TCTACAACACCGACCGCATGGTCAAGGAGTACACCATGCGCTACTACCTCAAGGAGCCTCGCCCCTGAACCATCGAAACA
GCATTATGACAACAACGACC

Downstream 100 bases:

>100_bases
GAACACGTGAAGCAGTGGGGAGACCTACCTGCGACGCCGGTAGCCGGAGAATCTGTTCCTGCGGCCTGGCATGGAGCGAA
ATGATGGCGTGTTGTAATGG

Product: dihydroorotate dehydrogenase

Products: NA

Alternate protein names: DHOdehase; DHOD; DHODase; Dihydroorotate oxidase [H]

Number of amino acids: Translated: 305; Mature: 305

Protein sequence:

>305_residues
MNSPAAVKLGRGLNLRSPVMLASGTVSYGEELSQLCDLSKIGGLVTKAISPEPRTGNPPQRIAETSCGMINAIGLANVGL
DKFVSDKVPFLQTLDTQVIVNIAGKSIDDYCQVVERLDTVEGIAAYELNLSCPNVKGECMIMGVSPDATREIVSTLRKQT
RRHLMVKLTPNVTSISAIALAAEEAGADSVSLINTVVGMAVDYRKRKPLLKNVTGGLSGPAIKPIALAKVWEVSKAVKIP
IVGMGGIASFSDAMEFLLVGASAIQIGTMNFVYPDIGEKIAVAIDKFFSQPDAPAFQEYVGSLMV

Sequences:

>Translated_305_residues
MNSPAAVKLGRGLNLRSPVMLASGTVSYGEELSQLCDLSKIGGLVTKAISPEPRTGNPPQRIAETSCGMINAIGLANVGL
DKFVSDKVPFLQTLDTQVIVNIAGKSIDDYCQVVERLDTVEGIAAYELNLSCPNVKGECMIMGVSPDATREIVSTLRKQT
RRHLMVKLTPNVTSISAIALAAEEAGADSVSLINTVVGMAVDYRKRKPLLKNVTGGLSGPAIKPIALAKVWEVSKAVKIP
IVGMGGIASFSDAMEFLLVGASAIQIGTMNFVYPDIGEKIAVAIDKFFSQPDAPAFQEYVGSLMV
>Mature_305_residues
MNSPAAVKLGRGLNLRSPVMLASGTVSYGEELSQLCDLSKIGGLVTKAISPEPRTGNPPQRIAETSCGMINAIGLANVGL
DKFVSDKVPFLQTLDTQVIVNIAGKSIDDYCQVVERLDTVEGIAAYELNLSCPNVKGECMIMGVSPDATREIVSTLRKQT
RRHLMVKLTPNVTSISAIALAAEEAGADSVSLINTVVGMAVDYRKRKPLLKNVTGGLSGPAIKPIALAKVWEVSKAVKIP
IVGMGGIASFSDAMEFLLVGASAIQIGTMNFVYPDIGEKIAVAIDKFFSQPDAPAFQEYVGSLMV

Specific function: Unknown

COG id: COG0167

COG function: function code F; Dihydroorotate dehydrogenase

Gene ontology:

Cell location: Cytoplasm [H]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the dihydroorotate dehydrogenase family. Type 1 subfamily [H]

Homologues:

Organism=Homo sapiens, GI119943098, Length=283, Percent_Identity=31.4487632508834, Blast_Score=97, Evalue=2e-20,
Organism=Homo sapiens, GI45006951, Length=309, Percent_Identity=26.2135922330097, Blast_Score=79, Evalue=5e-15,
Organism=Escherichia coli, GI87082059, Length=219, Percent_Identity=31.0502283105023, Blast_Score=99, Evalue=4e-22,
Organism=Caenorhabditis elegans, GI71984108, Length=150, Percent_Identity=36, Blast_Score=84, Evalue=1e-16,
Organism=Saccharomyces cerevisiae, GI6322633, Length=271, Percent_Identity=33.9483394833948, Blast_Score=115, Evalue=8e-27,
Organism=Drosophila melanogaster, GI24640763, Length=155, Percent_Identity=38.7096774193548, Blast_Score=92, Evalue=4e-19,
Organism=Drosophila melanogaster, GI18858217, Length=155, Percent_Identity=38.7096774193548, Blast_Score=92, Evalue=4e-19,
Organism=Drosophila melanogaster, GI281361352, Length=281, Percent_Identity=28.4697508896797, Blast_Score=67, Evalue=2e-11,
Organism=Drosophila melanogaster, GI17137316, Length=281, Percent_Identity=28.4697508896797, Blast_Score=67, Evalue=2e-11,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR013785
- InterPro:   IPR005720
- InterPro:   IPR012135
- InterPro:   IPR001295 [H]

Pfam domain/function: PF01180 DHO_dh [H]

EC number: =1.3.3.1 [H]

Molecular weight: Translated: 32270; Mature: 32270

Theoretical pI: Translated: 7.09; Mature: 7.09

Prosite motif: PS00012 PHOSPHOPANTETHEINE ; PS00912 DHODEHASE_2

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.6 %Cys     (Translated Protein)
3.6 %Met     (Translated Protein)
5.2 %Cys+Met (Translated Protein)
1.6 %Cys     (Mature Protein)
3.6 %Met     (Mature Protein)
5.2 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MNSPAAVKLGRGLNLRSPVMLASGTVSYGEELSQLCDLSKIGGLVTKAISPEPRTGNPPQ
CCCCCEEEECCCCCCCCCEEEECCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCHH
RIAETSCGMINAIGLANVGLDKFVSDKVPFLQTLDTQVIVNIAGKSIDDYCQVVERLDTV
HHHHHCCCHHHHHHHHHCCHHHHHHCCCCHHHHCCHHEEEEECCCCHHHHHHHHHHHHHH
EGIAAYELNLSCPNVKGECMIMGVSPDATREIVSTLRKQTRRHLMVKLTPNVTSISAIAL
CCEEEEEEECCCCCCCCCEEEEECCCHHHHHHHHHHHHHHHHCEEEEECCCCHHHHHHHH
AAEEAGADSVSLINTVVGMAVDYRKRKPLLKNVTGGLSGPAIKPIALAKVWEVSKAVKIP
HHHHCCCCHHHHHHHHHHHHHHHHHCCCHHHHHCCCCCCCCCCHHHHHHHHHHHHHEEEE
IVGMGGIASFSDAMEFLLVGASAIQIGTMNFVYPDIGEKIAVAIDKFFSQPDAPAFQEYV
EEECCCHHHHHHHHHHHHHCCHHEEECCCEEECCCCCHHHHHHHHHHHCCCCCHHHHHHH
GSLMV
HHHCC
>Mature Secondary Structure
MNSPAAVKLGRGLNLRSPVMLASGTVSYGEELSQLCDLSKIGGLVTKAISPEPRTGNPPQ
CCCCCEEEECCCCCCCCCEEEECCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCHH
RIAETSCGMINAIGLANVGLDKFVSDKVPFLQTLDTQVIVNIAGKSIDDYCQVVERLDTV
HHHHHCCCHHHHHHHHHCCHHHHHHCCCCHHHHCCHHEEEEECCCCHHHHHHHHHHHHHH
EGIAAYELNLSCPNVKGECMIMGVSPDATREIVSTLRKQTRRHLMVKLTPNVTSISAIAL
CCEEEEEEECCCCCCCCCEEEEECCCHHHHHHHHHHHHHHHHCEEEEECCCCHHHHHHHH
AAEEAGADSVSLINTVVGMAVDYRKRKPLLKNVTGGLSGPAIKPIALAKVWEVSKAVKIP
HHHHCCCCHHHHHHHHHHHHHHHHHCCCHHHHHCCCCCCCCCCHHHHHHHHHHHHHEEEE
IVGMGGIASFSDAMEFLLVGASAIQIGTMNFVYPDIGEKIAVAIDKFFSQPDAPAFQEYV
EEECCCHHHHHHHHHHHHHCCHHEEECCCEEECCCCCHHHHHHHHHHHCCCCCHHHHHHH
GSLMV
HHHCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: NA