Definition Beijerinckia indica subsp. indica ATCC 9039 chromosome, complete genome.
Accession NC_010581
Length 4,170,153

Click here to switch to the map view.

The map label for this gene is hemC [H]

Identifier: 182677009

GI number: 182677009

Start: 5533

End: 6546

Strand: Direct

Name: hemC [H]

Synonym: Bind_0007

Alternate gene names: 182677009

Gene position: 5533-6546 (Clockwise)

Preceding gene: 182677007

Following gene: 182677010

Centisome position: 0.13

GC content: 63.71

Gene sequence:

>1014_bases
ATGTCGAGGAATAGCACGATCGCTAACCCGCCGATAGATCAACCCCTTCCCCGTCTGCGGCTCGGCACGCGCGGCAGCCC
GCTGGCGCTTGCCCAGGCGCATGAGCTGGCAGATCGTCTTGCCCGCGCGCATGGCTTTGCGAAAGAAGCAGTTGCCATCA
CGATCATCCGCACGAGCGGCGACATGATTCAGGACCGGCCCCTTTCCTTGGCGGGAGGCAAGGGCCTGTTCACCAAGGAA
CTCGATCAGGCCTTGATCGAAGGCATGGTCGATCTCGCCGTCCATTCCGCCAAGGACCTGCCGACCATCCTGCCGGAAGA
CCTCATCATCGCCGGCTATTTGCCGCGCGAGGACGTGCGCGATGTCTGGATCTCCCCAAAGGCCGGCCATCCGCGCGATT
TGCCGCCGGGCTCTGTCGTCGGTACGGCCTCGCTGCGGCGCGGTGCACTTTTGAAACGGCTGCGCCCCGATCTCGAAGTC
AGATTATTGCGCGGCAATGTCGAGACGCGGCTCGCCAAACTGGCCGCCGGGGAGGTCGATGCGACTTTACTGGCACTGGC
TGGCCTCCGTCGCCTCGGCCTTGCCGACAAGGCGACACAAGTGCTGGCGATCGAGGATTTTCTGCCCGCCGCCGGGCAGG
GCGCGATCGGCATTACGACACGGCGGGATGATGCGGCCACCCTGGCGCTTCTCGCGCCGATTCTCGATCCGGCGACTCAT
GTGGCGCTCGCCGCCGAGCGCGGCTTCCTCACCGTGCTCGATGGGTCCTGCAAAACGCCGATCGGTGCTCATGCCACGGT
CGAACACGATCAAGTCACTTTGCGCGGCATCGTCTTGCGGCCGGATGGATCGGAATGGTTCGAGGCCTGTGAAAGCGGTC
CCCTTGAAAGCGGTTCCCTGGAGGCGGCGCGGGAATTAGGCGAAACCGCAGCGCGCGCTATTCTGGCGCGGTTGCCGGAA
GGATTCTTCCAAGAGAGCGCCCAAGAAAATGCCCAAAAAAACGCTAAGGAGTAG

Upstream 100 bases:

>100_bases
CCGGCCTTGACCGTGAAGTTTGGGAAAGGCGGAAGCCGCCGCGCAACGCCCAATCATCACCAAGGCCAATCCTCATCAAG
AATGAATGTTGGCATGAGTT

Downstream 100 bases:

>100_bases
AGAGCGTGCTGGTTCTGATCACGAGGCCTTTCGAGGAAGCCCTGCGCAGCGCCGCCAAGCTCGAGGGAGCCGGCTATTCC
GCGCTCTTGTCGCCGGTCCT

Product: porphobilinogen deaminase

Products: NA

Alternate protein names: PBG; Hydroxymethylbilane synthase; HMBS; Pre-uroporphyrinogen synthase [H]

Number of amino acids: Translated: 337; Mature: 336

Protein sequence:

>337_residues
MSRNSTIANPPIDQPLPRLRLGTRGSPLALAQAHELADRLARAHGFAKEAVAITIIRTSGDMIQDRPLSLAGGKGLFTKE
LDQALIEGMVDLAVHSAKDLPTILPEDLIIAGYLPREDVRDVWISPKAGHPRDLPPGSVVGTASLRRGALLKRLRPDLEV
RLLRGNVETRLAKLAAGEVDATLLALAGLRRLGLADKATQVLAIEDFLPAAGQGAIGITTRRDDAATLALLAPILDPATH
VALAAERGFLTVLDGSCKTPIGAHATVEHDQVTLRGIVLRPDGSEWFEACESGPLESGSLEAARELGETAARAILARLPE
GFFQESAQENAQKNAKE

Sequences:

>Translated_337_residues
MSRNSTIANPPIDQPLPRLRLGTRGSPLALAQAHELADRLARAHGFAKEAVAITIIRTSGDMIQDRPLSLAGGKGLFTKE
LDQALIEGMVDLAVHSAKDLPTILPEDLIIAGYLPREDVRDVWISPKAGHPRDLPPGSVVGTASLRRGALLKRLRPDLEV
RLLRGNVETRLAKLAAGEVDATLLALAGLRRLGLADKATQVLAIEDFLPAAGQGAIGITTRRDDAATLALLAPILDPATH
VALAAERGFLTVLDGSCKTPIGAHATVEHDQVTLRGIVLRPDGSEWFEACESGPLESGSLEAARELGETAARAILARLPE
GFFQESAQENAQKNAKE
>Mature_336_residues
SRNSTIANPPIDQPLPRLRLGTRGSPLALAQAHELADRLARAHGFAKEAVAITIIRTSGDMIQDRPLSLAGGKGLFTKEL
DQALIEGMVDLAVHSAKDLPTILPEDLIIAGYLPREDVRDVWISPKAGHPRDLPPGSVVGTASLRRGALLKRLRPDLEVR
LLRGNVETRLAKLAAGEVDATLLALAGLRRLGLADKATQVLAIEDFLPAAGQGAIGITTRRDDAATLALLAPILDPATHV
ALAAERGFLTVLDGSCKTPIGAHATVEHDQVTLRGIVLRPDGSEWFEACESGPLESGSLEAARELGETAARAILARLPEG
FFQESAQENAQKNAKE

Specific function: Tetrapolymerization of the monopyrrole PBG into the hydroxymethylbilane pre-uroporphyrinogen in several discrete steps [H]

COG id: COG0181

COG function: function code H; Porphobilinogen deaminase

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the HMBS family [H]

Homologues:

Organism=Homo sapiens, GI20149500, Length=279, Percent_Identity=41.5770609318996, Blast_Score=182, Evalue=5e-46,
Organism=Homo sapiens, GI66933009, Length=279, Percent_Identity=41.5770609318996, Blast_Score=181, Evalue=6e-46,
Organism=Escherichia coli, GI48994974, Length=307, Percent_Identity=45.928338762215, Blast_Score=228, Evalue=6e-61,
Organism=Saccharomyces cerevisiae, GI6319996, Length=281, Percent_Identity=35.9430604982206, Blast_Score=163, Evalue=4e-41,
Organism=Drosophila melanogaster, GI20130425, Length=255, Percent_Identity=40.7843137254902, Blast_Score=170, Evalue=2e-42,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR000860
- InterPro:   IPR022419
- InterPro:   IPR022417
- InterPro:   IPR022418 [H]

Pfam domain/function: PF01379 Porphobil_deam; PF03900 Porphobil_deamC [H]

EC number: =2.5.1.61 [H]

Molecular weight: Translated: 35809; Mature: 35677

Theoretical pI: Translated: 6.19; Mature: 6.19

Prosite motif: PS00533 PORPHOBILINOGEN_DEAM

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.6 %Cys     (Translated Protein)
0.9 %Met     (Translated Protein)
1.5 %Cys+Met (Translated Protein)
0.6 %Cys     (Mature Protein)
0.6 %Met     (Mature Protein)
1.2 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSRNSTIANPPIDQPLPRLRLGTRGSPLALAQAHELADRLARAHGFAKEAVAITIIRTSG
CCCCCCCCCCCCCCCCCHHCCCCCCCCHHHHHHHHHHHHHHHHHCCCCCCEEEEEEECCC
DMIQDRPLSLAGGKGLFTKELDQALIEGMVDLAVHSAKDLPTILPEDLIIAGYLPREDVR
CCCCCCCCEECCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCEEECCCCHHHHH
DVWISPKAGHPRDLPPGSVVGTASLRRGALLKRLRPDLEVRLLRGNVETRLAKLAAGEVD
HEEECCCCCCCCCCCCCCEEEHHHHHHHHHHHHHCCCCEEEEECCCHHHHHHHHHCCCHH
ATLLALAGLRRLGLADKATQVLAIEDFLPAAGQGAIGITTRRDDAATLALLAPILDPATH
HHHHHHHHHHHHCCCHHHHHEEEHHHHCCCCCCCCEEEEECCCCHHHHHHHHHHHCHHHH
VALAAERGFLTVLDGSCKTPIGAHATVEHDQVTLRGIVLRPDGSEWFEACESGPLESGSL
HHHHHCCCEEEEECCCCCCCCCCCEEECCCEEEEEEEEECCCCHHHHHHHHCCCCCCCCH
EAARELGETAARAILARLPEGFFQESAQENAQKNAKE
HHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHCCCC
>Mature Secondary Structure 
SRNSTIANPPIDQPLPRLRLGTRGSPLALAQAHELADRLARAHGFAKEAVAITIIRTSG
CCCCCCCCCCCCCCCCHHCCCCCCCCHHHHHHHHHHHHHHHHHCCCCCCEEEEEEECCC
DMIQDRPLSLAGGKGLFTKELDQALIEGMVDLAVHSAKDLPTILPEDLIIAGYLPREDVR
CCCCCCCCEECCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCEEECCCCHHHHH
DVWISPKAGHPRDLPPGSVVGTASLRRGALLKRLRPDLEVRLLRGNVETRLAKLAAGEVD
HEEECCCCCCCCCCCCCCEEEHHHHHHHHHHHHHCCCCEEEEECCCHHHHHHHHHCCCHH
ATLLALAGLRRLGLADKATQVLAIEDFLPAAGQGAIGITTRRDDAATLALLAPILDPATH
HHHHHHHHHHHHCCCHHHHHEEEHHHHCCCCCCCCEEEEECCCCHHHHHHHHHHHCHHHH
VALAAERGFLTVLDGSCKTPIGAHATVEHDQVTLRGIVLRPDGSEWFEACESGPLESGSL
HHHHHCCCEEEEECCCCCCCCCCCEEECCCEEEEEEEEECCCCHHHHHHHHCCCCCCCCH
EAARELGETAARAILARLPEGFFQESAQENAQKNAKE
HHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: NA