Definition Novosphingobium aromaticivorans DSM 12444 chromosome, complete genome.
Accession NC_007794
Length 3,561,584

Click here to switch to the map view.

The map label for this gene is hemE

Identifier: 87198144

GI number: 87198144

Start: 119850

End: 120875

Strand: Direct

Name: hemE

Synonym: Saro_0118

Alternate gene names: 87198144

Gene position: 119850-120875 (Clockwise)

Preceding gene: 87198133

Following gene: 87198145

Centisome position: 3.37

GC content: 63.26

Gene sequence:

>1026_bases
ATGCCCGGCCCTCTTCTGAAGACGCTCCAGGGTGAGAACATTTCCCGCCGACCGATCTGGCTCATGCGCCAGGCCGGACG
CTATCTGCCCGAGTACCGCGAGCTTCGCGCCGAGAAGGGCGGCTTCCTCGCGCTGGTCTACGACACTGACGCAGCGGCCG
AAGTTACCGTGCAGCCGATCCGTCGTTTCGGCTTCGACGGCGCGATCCTGTTTTCCGACATCCTGATCGTACCCTATGCG
ATGGGACAGGATCTCCAGTTCCTCGCCGGCGAAGGTCCGCACCTGTCACCACGCTTGCTCGACGCCGCGCTGAACAGCCT
CGTGGCGGTGCCCGGGCGCCTCTCGCCGATCTACGAGACGGTTGCCAAGGTGAAGGCCCAGCTTTCGCCTGAAACCACGC
TGCTCGGCTTTGCCGGCAGTCCGTGGACGGTCGCAACCTACATGGTGGCCGGCGAAGGCAGCCGTGACCATCACGATACC
CGCGCGCTTGCCTATCGTGATCCTTCGGCGTTCCAGGCAATCATCGATGCGATTACGGAAGTGACCATCGAGTATCTTTC
GGGCCAGGTCGAAGCGGGTGCGGAAGGGCTGCAACTGTTCGATTCTTGGTCGGGCAGCCTTGCTCCGGCCGAATTCGAAC
GTTGGGTCATCGCGCCCAACGCCAGGATCGCCTCCGCGATGCAGCAGCGTTATCCCCACGTGCCTGTGATCGGGTTCCCC
AAGGGCGCTGGCGAAAAGCTTTCCGCCTATGCCCGCGAGACAGGCGTCAACGCGGTCGGCGTGGACGAAACCATCGATCC
GTTATGGGCTGCGCGCGAACTCCCGGCGAACATGCCGGTACAGGGCAATCTCGATCCGCTTCTGCTCCTTTCGGGCGGCC
CTGAGCTGGAACGGCAGACGATCCGTGTTCTCGAAGCCTTTGCCGACCGCCCGCACGTCTTCAATCTTGGCCACGGCATC
GGTCAGCACACTCCGATCGAAAACGTCGAAGCGCTTCTGAAGATCGTGCGAGGCTGGTCGCGCTGA

Upstream 100 bases:

>100_bases
TTCAGGCAGAGCGCCGCAATCCCCGGTTTCCACAGGGCCAACAAACACCATCAACCAGATTCAATAGAATCTTATTTATT
TGGATTGGACCGAAAGACCG

Downstream 100 bases:

>100_bases
GCATTCGGGACACTTGCAAAGACCTTCGCGCACGCCGAAATAGCCCCTCGGGGCGCATTGGCAGGCGAGACCGCAATTCA
TGCAGCAGGTATTGGCGATG

Product: uroporphyrinogen decarboxylase

Products: NA

Alternate protein names: UPD; URO-D

Number of amino acids: Translated: 341; Mature: 340

Protein sequence:

>341_residues
MPGPLLKTLQGENISRRPIWLMRQAGRYLPEYRELRAEKGGFLALVYDTDAAAEVTVQPIRRFGFDGAILFSDILIVPYA
MGQDLQFLAGEGPHLSPRLLDAALNSLVAVPGRLSPIYETVAKVKAQLSPETTLLGFAGSPWTVATYMVAGEGSRDHHDT
RALAYRDPSAFQAIIDAITEVTIEYLSGQVEAGAEGLQLFDSWSGSLAPAEFERWVIAPNARIASAMQQRYPHVPVIGFP
KGAGEKLSAYARETGVNAVGVDETIDPLWAARELPANMPVQGNLDPLLLLSGGPELERQTIRVLEAFADRPHVFNLGHGI
GQHTPIENVEALLKIVRGWSR

Sequences:

>Translated_341_residues
MPGPLLKTLQGENISRRPIWLMRQAGRYLPEYRELRAEKGGFLALVYDTDAAAEVTVQPIRRFGFDGAILFSDILIVPYA
MGQDLQFLAGEGPHLSPRLLDAALNSLVAVPGRLSPIYETVAKVKAQLSPETTLLGFAGSPWTVATYMVAGEGSRDHHDT
RALAYRDPSAFQAIIDAITEVTIEYLSGQVEAGAEGLQLFDSWSGSLAPAEFERWVIAPNARIASAMQQRYPHVPVIGFP
KGAGEKLSAYARETGVNAVGVDETIDPLWAARELPANMPVQGNLDPLLLLSGGPELERQTIRVLEAFADRPHVFNLGHGI
GQHTPIENVEALLKIVRGWSR
>Mature_340_residues
PGPLLKTLQGENISRRPIWLMRQAGRYLPEYRELRAEKGGFLALVYDTDAAAEVTVQPIRRFGFDGAILFSDILIVPYAM
GQDLQFLAGEGPHLSPRLLDAALNSLVAVPGRLSPIYETVAKVKAQLSPETTLLGFAGSPWTVATYMVAGEGSRDHHDTR
ALAYRDPSAFQAIIDAITEVTIEYLSGQVEAGAEGLQLFDSWSGSLAPAEFERWVIAPNARIASAMQQRYPHVPVIGFPK
GAGEKLSAYARETGVNAVGVDETIDPLWAARELPANMPVQGNLDPLLLLSGGPELERQTIRVLEAFADRPHVFNLGHGIG
QHTPIENVEALLKIVRGWSR

Specific function: Catalyzes the decarboxylation of four acetate groups of uroporphyrinogen-III to yield coproporphyrinogen-III

COG id: COG0407

COG function: function code H; Uroporphyrinogen-III decarboxylase

Gene ontology:

Cell location: Cytoplasm

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the uroporphyrinogen decarboxylase family

Homologues:

Organism=Homo sapiens, GI71051616, Length=346, Percent_Identity=34.971098265896, Blast_Score=202, Evalue=4e-52,
Organism=Escherichia coli, GI2367337, Length=347, Percent_Identity=39.193083573487, Blast_Score=237, Evalue=7e-64,
Organism=Saccharomyces cerevisiae, GI6320252, Length=330, Percent_Identity=34.2424242424242, Blast_Score=202, Evalue=9e-53,
Organism=Drosophila melanogaster, GI221330099, Length=340, Percent_Identity=36.7647058823529, Blast_Score=221, Evalue=4e-58,
Organism=Drosophila melanogaster, GI19921920, Length=340, Percent_Identity=36.7647058823529, Blast_Score=221, Evalue=4e-58,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): DCUP_NOVAD (Q2GC56)

Other databases:

- EMBL:   CP000248
- RefSeq:   YP_495401.1
- ProteinModelPortal:   Q2GC56
- SMR:   Q2GC56
- STRING:   Q2GC56
- GeneID:   3916004
- GenomeReviews:   CP000248_GR
- KEGG:   nar:Saro_0118
- NMPDR:   fig|48935.1.peg.4097
- eggNOG:   COG0407
- HOGENOM:   HBG628392
- OMA:   AVQLFDS
- PhylomeDB:   Q2GC56
- ProtClustDB:   PRK00115
- BioCyc:   NARO279238:SARO_0118-MONOMER
- GO:   GO:0005737
- HAMAP:   MF_00218
- InterPro:   IPR006361
- InterPro:   IPR000257
- PANTHER:   PTHR21091:SF2
- TIGRFAMs:   TIGR01464

Pfam domain/function: PF01208 URO-D

EC number: =4.1.1.37

Molecular weight: Translated: 37182; Mature: 37051

Theoretical pI: Translated: 5.23; Mature: 5.23

Prosite motif: PS00906 UROD_1; PS00907 UROD_2

Important sites: BINDING 73-73 BINDING 147-147 BINDING 202-202 BINDING 318-318

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.0 %Cys     (Translated Protein)
1.8 %Met     (Translated Protein)
1.8 %Cys+Met (Translated Protein)
0.0 %Cys     (Mature Protein)
1.5 %Met     (Mature Protein)
1.5 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MPGPLLKTLQGENISRRPIWLMRQAGRYLPEYRELRAEKGGFLALVYDTDAAAEVTVQPI
CCCHHHHHHCCCCCCCCHHHHHHHHHHCCHHHHHHHHCCCCEEEEEEECCCCCHHHHHHH
RRFGFDGAILFSDILIVPYAMGQDLQFLAGEGPHLSPRLLDAALNSLVAVPGRLSPIYET
HHCCCCCHHHHHHHHHHHHHCCCCCHHHCCCCCCCCHHHHHHHHHHHHCCCCCCHHHHHH
VAKVKAQLSPETTLLGFAGSPWTVATYMVAGEGSRDHHDTRALAYRDPSAFQAIIDAITE
HHHHHHHCCCCEEEEECCCCCCEEEEEEEECCCCCCCCCCCEEEECCHHHHHHHHHHHHH
VTIEYLSGQVEAGAEGLQLFDSWSGSLAPAEFERWVIAPNARIASAMQQRYPHVPVIGFP
HHHHHHCCCCCCCHHHHHHHHCCCCCCCCCCCCCEEECCCHHHHHHHHHHCCCCCEEECC
KGAGEKLSAYARETGVNAVGVDETIDPLWAARELPANMPVQGNLDPLLLLSGGPELERQT
CCCCHHHHHHHHHHCCCEECCCCHHHHHHHHHHCCCCCCCCCCCCEEEEECCCCHHHHHH
IRVLEAFADRPHVFNLGHGIGQHTPIENVEALLKIVRGWSR
HHHHHHHCCCCCEEECCCCCCCCCCHHHHHHHHHHHHHCCC
>Mature Secondary Structure 
PGPLLKTLQGENISRRPIWLMRQAGRYLPEYRELRAEKGGFLALVYDTDAAAEVTVQPI
CCHHHHHHCCCCCCCCHHHHHHHHHHCCHHHHHHHHCCCCEEEEEEECCCCCHHHHHHH
RRFGFDGAILFSDILIVPYAMGQDLQFLAGEGPHLSPRLLDAALNSLVAVPGRLSPIYET
HHCCCCCHHHHHHHHHHHHHCCCCCHHHCCCCCCCCHHHHHHHHHHHHCCCCCCHHHHHH
VAKVKAQLSPETTLLGFAGSPWTVATYMVAGEGSRDHHDTRALAYRDPSAFQAIIDAITE
HHHHHHHCCCCEEEEECCCCCCEEEEEEEECCCCCCCCCCCEEEECCHHHHHHHHHHHHH
VTIEYLSGQVEAGAEGLQLFDSWSGSLAPAEFERWVIAPNARIASAMQQRYPHVPVIGFP
HHHHHHCCCCCCCHHHHHHHHCCCCCCCCCCCCCEEECCCHHHHHHHHHHCCCCCEEECC
KGAGEKLSAYARETGVNAVGVDETIDPLWAARELPANMPVQGNLDPLLLLSGGPELERQT
CCCCHHHHHHHHHHCCCEECCCCHHHHHHHHHHCCCCCCCCCCCCEEEEECCCCHHHHHH
IRVLEAFADRPHVFNLGHGIGQHTPIENVEALLKIVRGWSR
HHHHHHHCCCCCEEECCCCCCCCCCHHHHHHHHHHHHHCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: NA