| Definition | Novosphingobium aromaticivorans DSM 12444 chromosome, complete genome. |
|---|---|
| Accession | NC_007794 |
| Length | 3,561,584 |
Click here to switch to the map view.
The map label for this gene is hemE
Identifier: 87198144
GI number: 87198144
Start: 119850
End: 120875
Strand: Direct
Name: hemE
Synonym: Saro_0118
Alternate gene names: 87198144
Gene position: 119850-120875 (Clockwise)
Preceding gene: 87198133
Following gene: 87198145
Centisome position: 3.37
GC content: 63.26
Gene sequence:
>1026_bases ATGCCCGGCCCTCTTCTGAAGACGCTCCAGGGTGAGAACATTTCCCGCCGACCGATCTGGCTCATGCGCCAGGCCGGACG CTATCTGCCCGAGTACCGCGAGCTTCGCGCCGAGAAGGGCGGCTTCCTCGCGCTGGTCTACGACACTGACGCAGCGGCCG AAGTTACCGTGCAGCCGATCCGTCGTTTCGGCTTCGACGGCGCGATCCTGTTTTCCGACATCCTGATCGTACCCTATGCG ATGGGACAGGATCTCCAGTTCCTCGCCGGCGAAGGTCCGCACCTGTCACCACGCTTGCTCGACGCCGCGCTGAACAGCCT CGTGGCGGTGCCCGGGCGCCTCTCGCCGATCTACGAGACGGTTGCCAAGGTGAAGGCCCAGCTTTCGCCTGAAACCACGC TGCTCGGCTTTGCCGGCAGTCCGTGGACGGTCGCAACCTACATGGTGGCCGGCGAAGGCAGCCGTGACCATCACGATACC CGCGCGCTTGCCTATCGTGATCCTTCGGCGTTCCAGGCAATCATCGATGCGATTACGGAAGTGACCATCGAGTATCTTTC GGGCCAGGTCGAAGCGGGTGCGGAAGGGCTGCAACTGTTCGATTCTTGGTCGGGCAGCCTTGCTCCGGCCGAATTCGAAC GTTGGGTCATCGCGCCCAACGCCAGGATCGCCTCCGCGATGCAGCAGCGTTATCCCCACGTGCCTGTGATCGGGTTCCCC AAGGGCGCTGGCGAAAAGCTTTCCGCCTATGCCCGCGAGACAGGCGTCAACGCGGTCGGCGTGGACGAAACCATCGATCC GTTATGGGCTGCGCGCGAACTCCCGGCGAACATGCCGGTACAGGGCAATCTCGATCCGCTTCTGCTCCTTTCGGGCGGCC CTGAGCTGGAACGGCAGACGATCCGTGTTCTCGAAGCCTTTGCCGACCGCCCGCACGTCTTCAATCTTGGCCACGGCATC GGTCAGCACACTCCGATCGAAAACGTCGAAGCGCTTCTGAAGATCGTGCGAGGCTGGTCGCGCTGA
Upstream 100 bases:
>100_bases TTCAGGCAGAGCGCCGCAATCCCCGGTTTCCACAGGGCCAACAAACACCATCAACCAGATTCAATAGAATCTTATTTATT TGGATTGGACCGAAAGACCG
Downstream 100 bases:
>100_bases GCATTCGGGACACTTGCAAAGACCTTCGCGCACGCCGAAATAGCCCCTCGGGGCGCATTGGCAGGCGAGACCGCAATTCA TGCAGCAGGTATTGGCGATG
Product: uroporphyrinogen decarboxylase
Products: NA
Alternate protein names: UPD; URO-D
Number of amino acids: Translated: 341; Mature: 340
Protein sequence:
>341_residues MPGPLLKTLQGENISRRPIWLMRQAGRYLPEYRELRAEKGGFLALVYDTDAAAEVTVQPIRRFGFDGAILFSDILIVPYA MGQDLQFLAGEGPHLSPRLLDAALNSLVAVPGRLSPIYETVAKVKAQLSPETTLLGFAGSPWTVATYMVAGEGSRDHHDT RALAYRDPSAFQAIIDAITEVTIEYLSGQVEAGAEGLQLFDSWSGSLAPAEFERWVIAPNARIASAMQQRYPHVPVIGFP KGAGEKLSAYARETGVNAVGVDETIDPLWAARELPANMPVQGNLDPLLLLSGGPELERQTIRVLEAFADRPHVFNLGHGI GQHTPIENVEALLKIVRGWSR
Sequences:
>Translated_341_residues MPGPLLKTLQGENISRRPIWLMRQAGRYLPEYRELRAEKGGFLALVYDTDAAAEVTVQPIRRFGFDGAILFSDILIVPYA MGQDLQFLAGEGPHLSPRLLDAALNSLVAVPGRLSPIYETVAKVKAQLSPETTLLGFAGSPWTVATYMVAGEGSRDHHDT RALAYRDPSAFQAIIDAITEVTIEYLSGQVEAGAEGLQLFDSWSGSLAPAEFERWVIAPNARIASAMQQRYPHVPVIGFP KGAGEKLSAYARETGVNAVGVDETIDPLWAARELPANMPVQGNLDPLLLLSGGPELERQTIRVLEAFADRPHVFNLGHGI GQHTPIENVEALLKIVRGWSR >Mature_340_residues PGPLLKTLQGENISRRPIWLMRQAGRYLPEYRELRAEKGGFLALVYDTDAAAEVTVQPIRRFGFDGAILFSDILIVPYAM GQDLQFLAGEGPHLSPRLLDAALNSLVAVPGRLSPIYETVAKVKAQLSPETTLLGFAGSPWTVATYMVAGEGSRDHHDTR ALAYRDPSAFQAIIDAITEVTIEYLSGQVEAGAEGLQLFDSWSGSLAPAEFERWVIAPNARIASAMQQRYPHVPVIGFPK GAGEKLSAYARETGVNAVGVDETIDPLWAARELPANMPVQGNLDPLLLLSGGPELERQTIRVLEAFADRPHVFNLGHGIG QHTPIENVEALLKIVRGWSR
Specific function: Catalyzes the decarboxylation of four acetate groups of uroporphyrinogen-III to yield coproporphyrinogen-III
COG id: COG0407
COG function: function code H; Uroporphyrinogen-III decarboxylase
Gene ontology:
Cell location: Cytoplasm
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the uroporphyrinogen decarboxylase family
Homologues:
Organism=Homo sapiens, GI71051616, Length=346, Percent_Identity=34.971098265896, Blast_Score=202, Evalue=4e-52, Organism=Escherichia coli, GI2367337, Length=347, Percent_Identity=39.193083573487, Blast_Score=237, Evalue=7e-64, Organism=Saccharomyces cerevisiae, GI6320252, Length=330, Percent_Identity=34.2424242424242, Blast_Score=202, Evalue=9e-53, Organism=Drosophila melanogaster, GI221330099, Length=340, Percent_Identity=36.7647058823529, Blast_Score=221, Evalue=4e-58, Organism=Drosophila melanogaster, GI19921920, Length=340, Percent_Identity=36.7647058823529, Blast_Score=221, Evalue=4e-58,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): DCUP_NOVAD (Q2GC56)
Other databases:
- EMBL: CP000248 - RefSeq: YP_495401.1 - ProteinModelPortal: Q2GC56 - SMR: Q2GC56 - STRING: Q2GC56 - GeneID: 3916004 - GenomeReviews: CP000248_GR - KEGG: nar:Saro_0118 - NMPDR: fig|48935.1.peg.4097 - eggNOG: COG0407 - HOGENOM: HBG628392 - OMA: AVQLFDS - PhylomeDB: Q2GC56 - ProtClustDB: PRK00115 - BioCyc: NARO279238:SARO_0118-MONOMER - GO: GO:0005737 - HAMAP: MF_00218 - InterPro: IPR006361 - InterPro: IPR000257 - PANTHER: PTHR21091:SF2 - TIGRFAMs: TIGR01464
Pfam domain/function: PF01208 URO-D
EC number: =4.1.1.37
Molecular weight: Translated: 37182; Mature: 37051
Theoretical pI: Translated: 5.23; Mature: 5.23
Prosite motif: PS00906 UROD_1; PS00907 UROD_2
Important sites: BINDING 73-73 BINDING 147-147 BINDING 202-202 BINDING 318-318
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.0 %Cys (Translated Protein) 1.8 %Met (Translated Protein) 1.8 %Cys+Met (Translated Protein) 0.0 %Cys (Mature Protein) 1.5 %Met (Mature Protein) 1.5 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MPGPLLKTLQGENISRRPIWLMRQAGRYLPEYRELRAEKGGFLALVYDTDAAAEVTVQPI CCCHHHHHHCCCCCCCCHHHHHHHHHHCCHHHHHHHHCCCCEEEEEEECCCCCHHHHHHH RRFGFDGAILFSDILIVPYAMGQDLQFLAGEGPHLSPRLLDAALNSLVAVPGRLSPIYET HHCCCCCHHHHHHHHHHHHHCCCCCHHHCCCCCCCCHHHHHHHHHHHHCCCCCCHHHHHH VAKVKAQLSPETTLLGFAGSPWTVATYMVAGEGSRDHHDTRALAYRDPSAFQAIIDAITE HHHHHHHCCCCEEEEECCCCCCEEEEEEEECCCCCCCCCCCEEEECCHHHHHHHHHHHHH VTIEYLSGQVEAGAEGLQLFDSWSGSLAPAEFERWVIAPNARIASAMQQRYPHVPVIGFP HHHHHHCCCCCCCHHHHHHHHCCCCCCCCCCCCCEEECCCHHHHHHHHHHCCCCCEEECC KGAGEKLSAYARETGVNAVGVDETIDPLWAARELPANMPVQGNLDPLLLLSGGPELERQT CCCCHHHHHHHHHHCCCEECCCCHHHHHHHHHHCCCCCCCCCCCCEEEEECCCCHHHHHH IRVLEAFADRPHVFNLGHGIGQHTPIENVEALLKIVRGWSR HHHHHHHCCCCCEEECCCCCCCCCCHHHHHHHHHHHHHCCC >Mature Secondary Structure PGPLLKTLQGENISRRPIWLMRQAGRYLPEYRELRAEKGGFLALVYDTDAAAEVTVQPI CCHHHHHHCCCCCCCCHHHHHHHHHHCCHHHHHHHHCCCCEEEEEEECCCCCHHHHHHH RRFGFDGAILFSDILIVPYAMGQDLQFLAGEGPHLSPRLLDAALNSLVAVPGRLSPIYET HHCCCCCHHHHHHHHHHHHHCCCCCHHHCCCCCCCCHHHHHHHHHHHHCCCCCCHHHHHH VAKVKAQLSPETTLLGFAGSPWTVATYMVAGEGSRDHHDTRALAYRDPSAFQAIIDAITE HHHHHHHCCCCEEEEECCCCCCEEEEEEEECCCCCCCCCCCEEEECCHHHHHHHHHHHHH VTIEYLSGQVEAGAEGLQLFDSWSGSLAPAEFERWVIAPNARIASAMQQRYPHVPVIGFP HHHHHHCCCCCCCHHHHHHHHCCCCCCCCCCCCCEEECCCHHHHHHHHHHCCCCCEEECC KGAGEKLSAYARETGVNAVGVDETIDPLWAARELPANMPVQGNLDPLLLLSGGPELERQT CCCCHHHHHHHHHHCCCEECCCCHHHHHHHHHHCCCCCCCCCCCCEEEEECCCCHHHHHH IRVLEAFADRPHVFNLGHGIGQHTPIENVEALLKIVRGWSR HHHHHHHCCCCCEEECCCCCCCCCCHHHHHHHHHHHHHCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 10.0
TargetDB status: NA
Availability: NA
References: NA