Definition Anaplasma phagocytophilum HZ, complete genome.
Accession NC_007797
Length 1,471,282

Click here to switch to the map view.

The map label for this gene is hemE [H]

Identifier: 88607724

GI number: 88607724

Start: 19525

End: 20556

Strand: Reverse

Name: hemE [H]

Synonym: APH_0020

Alternate gene names: 88607724

Gene position: 20556-19525 (Counterclockwise)

Preceding gene: 88607432

Following gene: 88607040

Centisome position: 1.4

GC content: 38.95

Gene sequence:

>1032_bases
ATGAAGATTATTATATATAACAAAAAGACAATAACTGTGTTACGAGAGATACTGACCACCAGAAGAAGCACACAGCGCTT
ACCAATATGGTTCATGAGACAAGCTGGAAGGTATCTACCAGAATATCAAAAGGTTATGGCGCATGTACAAGACTTCCTAG
AAGCGTGTTACACCCCAGAAATCGTTGAAGAGGTTACATTACAACCCATACAAAGATTCGACCTAGACGCAGCAATCATA
TTTTCAGATATTATGACTGTACCAGACGCGTTAGGATTCGAAGTAGTATTCAAAAGAGGCTATGGACCACAAATAAATGC
TAAAACGAGAAGAGAAGTAACGCTAGAATGGTCACTAGAGAAGGTGTCTCCCGTCTTGGAAAGTATAAAAAGGGTGCGAA
AATCTCTATCTCCTAACAAATCACTAATAGGGTTCGCAGGATCGCCTTGGACGGTAGCCACGTACATATTGGAGCAAGAA
AAAAAGATAACTGACATATTCGCTCTACACCGTTCCGGAGATAATTCCGTGGCAAAACTTATCGATGAAATCGTATCTTT
CACCACTGTTTACTTGAAAAAGCAGGTTGAATATGGAGTTGATATATTACAATTGTTCGACAGTAATGCTTCAGGGCTTC
CTGTAGACTTGTTCGAGACATTCATTGTTGAACCAACTCAGAGAATAGTAAAAGAACTTAGAAAACACCATCCTTCAATA
CCTATTATAGGCTTTCCAAAAGGAGCAGGAGTTCTTTATACACATTATGCTTTAACTACAGGAATATCTGCAGTAAGCGT
GGACTATAGTATCCCCTCTCAATGGATAAAGAACAATATTAGTGGAGTTGTTCAAGGAAATTTAGATCCATTTCTTTTAG
CTTATGATGTAGAAGGTGCCCTTAAATGTGCCGGAGAAATCATCGCTGACTTACGCGATAAGCCACTAATCTTTAACTTA
GGGCATGGCATAATACCGCCTACACCGGTCGATAACGTTTATAGATTGGTTGACTTTGTAAGAAGTTTTTAA

Upstream 100 bases:

>100_bases
AAATTATTCACAAAAAGAAAATTTATGAGTCATGTGTTTTTCAACACAGAAAAAGTTATCCACGCAATTAACAGGTATAA
ATTACTTATATTTATATATA

Downstream 100 bases:

>100_bases
CCGCGTGTTTGCTTTATATTCACCATTAAAGCTTGACACTTTTACACCTTACTCTGTAAGTTTTGTCTACGCTCTTTGTA
TTATGCGCTTTTTTCGGGAT

Product: uroporphyrinogen decarboxylase

Products: NA

Alternate protein names: UPD; URO-D [H]

Number of amino acids: Translated: 343; Mature: 343

Protein sequence:

>343_residues
MKIIIYNKKTITVLREILTTRRSTQRLPIWFMRQAGRYLPEYQKVMAHVQDFLEACYTPEIVEEVTLQPIQRFDLDAAII
FSDIMTVPDALGFEVVFKRGYGPQINAKTRREVTLEWSLEKVSPVLESIKRVRKSLSPNKSLIGFAGSPWTVATYILEQE
KKITDIFALHRSGDNSVAKLIDEIVSFTTVYLKKQVEYGVDILQLFDSNASGLPVDLFETFIVEPTQRIVKELRKHHPSI
PIIGFPKGAGVLYTHYALTTGISAVSVDYSIPSQWIKNNISGVVQGNLDPFLLAYDVEGALKCAGEIIADLRDKPLIFNL
GHGIIPPTPVDNVYRLVDFVRSF

Sequences:

>Translated_343_residues
MKIIIYNKKTITVLREILTTRRSTQRLPIWFMRQAGRYLPEYQKVMAHVQDFLEACYTPEIVEEVTLQPIQRFDLDAAII
FSDIMTVPDALGFEVVFKRGYGPQINAKTRREVTLEWSLEKVSPVLESIKRVRKSLSPNKSLIGFAGSPWTVATYILEQE
KKITDIFALHRSGDNSVAKLIDEIVSFTTVYLKKQVEYGVDILQLFDSNASGLPVDLFETFIVEPTQRIVKELRKHHPSI
PIIGFPKGAGVLYTHYALTTGISAVSVDYSIPSQWIKNNISGVVQGNLDPFLLAYDVEGALKCAGEIIADLRDKPLIFNL
GHGIIPPTPVDNVYRLVDFVRSF
>Mature_343_residues
MKIIIYNKKTITVLREILTTRRSTQRLPIWFMRQAGRYLPEYQKVMAHVQDFLEACYTPEIVEEVTLQPIQRFDLDAAII
FSDIMTVPDALGFEVVFKRGYGPQINAKTRREVTLEWSLEKVSPVLESIKRVRKSLSPNKSLIGFAGSPWTVATYILEQE
KKITDIFALHRSGDNSVAKLIDEIVSFTTVYLKKQVEYGVDILQLFDSNASGLPVDLFETFIVEPTQRIVKELRKHHPSI
PIIGFPKGAGVLYTHYALTTGISAVSVDYSIPSQWIKNNISGVVQGNLDPFLLAYDVEGALKCAGEIIADLRDKPLIFNL
GHGIIPPTPVDNVYRLVDFVRSF

Specific function: Catalyzes the decarboxylation of four acetate groups of uroporphyrinogen-III to yield coproporphyrinogen-III [H]

COG id: COG0407

COG function: function code H; Uroporphyrinogen-III decarboxylase

Gene ontology:

Cell location: Cytoplasm [H]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the uroporphyrinogen decarboxylase family [H]

Homologues:

Organism=Homo sapiens, GI71051616, Length=338, Percent_Identity=35.207100591716, Blast_Score=171, Evalue=1e-42,
Organism=Escherichia coli, GI2367337, Length=351, Percent_Identity=33.3333333333333, Blast_Score=179, Evalue=3e-46,
Organism=Saccharomyces cerevisiae, GI6320252, Length=329, Percent_Identity=33.7386018237082, Blast_Score=142, Evalue=1e-34,
Organism=Drosophila melanogaster, GI221330099, Length=332, Percent_Identity=34.9397590361446, Blast_Score=184, Evalue=8e-47,
Organism=Drosophila melanogaster, GI19921920, Length=332, Percent_Identity=34.9397590361446, Blast_Score=183, Evalue=1e-46,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR006361
- InterPro:   IPR000257 [H]

Pfam domain/function: PF01208 URO-D [H]

EC number: =4.1.1.37 [H]

Molecular weight: Translated: 38774; Mature: 38774

Theoretical pI: Translated: 8.18; Mature: 8.18

Prosite motif: PS00906 UROD_1

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.6 %Cys     (Translated Protein)
1.2 %Met     (Translated Protein)
1.7 %Cys+Met (Translated Protein)
0.6 %Cys     (Mature Protein)
1.2 %Met     (Mature Protein)
1.7 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKIIIYNKKTITVLREILTTRRSTQRLPIWFMRQAGRYLPEYQKVMAHVQDFLEACYTPE
CEEEEECCHHHHHHHHHHHHHCCCCCCCHHHHHHHCCCCHHHHHHHHHHHHHHHHHCCHH
IVEEVTLQPIQRFDLDAAIIFSDIMTVPDALGFEVVFKRGYGPQINAKTRREVTLEWSLE
HHHHHHHHHHHHHCCHHHHHHHHHHHCCCCCCHHHHEECCCCCCCCCCCCEEEEEEECHH
KVSPVLESIKRVRKSLSPNKSLIGFAGSPWTVATYILEQEKKITDIFALHRSGDNSVAKL
HHHHHHHHHHHHHHHCCCCCCEEEECCCCHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHH
IDEIVSFTTVYLKKQVEYGVDILQLFDSNASGLPVDLFETFIVEPTQRIVKELRKHHPSI
HHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHCCHHHHHHHHHHHHCCCC
PIIGFPKGAGVLYTHYALTTGISAVSVDYSIPSQWIKNNISGVVQGNLDPFLLAYDVEGA
CEEECCCCCCEEEEHHHHHHCCHHEEECCCCCHHHHHCCCCEEEECCCCCEEEEEECCHH
LKCAGEIIADLRDKPLIFNLGHGIIPPTPVDNVYRLVDFVRSF
HHHHHHHHHHCCCCCEEEECCCCCCCCCCHHHHHHHHHHHHCC
>Mature Secondary Structure
MKIIIYNKKTITVLREILTTRRSTQRLPIWFMRQAGRYLPEYQKVMAHVQDFLEACYTPE
CEEEEECCHHHHHHHHHHHHHCCCCCCCHHHHHHHCCCCHHHHHHHHHHHHHHHHHCCHH
IVEEVTLQPIQRFDLDAAIIFSDIMTVPDALGFEVVFKRGYGPQINAKTRREVTLEWSLE
HHHHHHHHHHHHHCCHHHHHHHHHHHCCCCCCHHHHEECCCCCCCCCCCCEEEEEEECHH
KVSPVLESIKRVRKSLSPNKSLIGFAGSPWTVATYILEQEKKITDIFALHRSGDNSVAKL
HHHHHHHHHHHHHHHCCCCCCEEEECCCCHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHH
IDEIVSFTTVYLKKQVEYGVDILQLFDSNASGLPVDLFETFIVEPTQRIVKELRKHHPSI
HHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHCCHHHHHHHHHHHHCCCC
PIIGFPKGAGVLYTHYALTTGISAVSVDYSIPSQWIKNNISGVVQGNLDPFLLAYDVEGA
CEEECCCCCCEEEEHHHHHHCCHHEEECCCCCHHHHHCCCCEEEECCCCCEEEEEECCHH
LKCAGEIIADLRDKPLIFNLGHGIIPPTPVDNVYRLVDFVRSF
HHHHHHHHHHCCCCCEEEECCCCCCCCCCHHHHHHHHHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: NA