Definition Mycobacterium avium subsp. paratuberculosis K-10, complete genome.
Accession NC_002944
Length 4,829,781

Click here to switch to the map view.

The map label for this gene is mhpA

Identifier: 41406792

GI number: 41406792

Start: 714952

End: 716694

Strand: Direct

Name: mhpA

Synonym: MAP0694

Alternate gene names: 41406792

Gene position: 714952-716694 (Clockwise)

Preceding gene: 41406791

Following gene: 41406793

Centisome position: 14.8

GC content: 69.48

Gene sequence:

>1743_bases
ATGATCGCGCCGGGGCCACGGGCAACCGACCACGACACCGACGTCCTGGTGGTGGGTGCGGGTCCGGTCGGCCTGACGCT
CGCCAATATCCTTGGCCTGCAAGGTATCCGCACCGTGGTGGTCGAGGAGCGGGACACCCTGATCGACTACCCGCGAGGGG
TGGGCCTGGACGACGAGGCGCTGCGCACCTTCCAGTCGATCGGGCTTGTCGAGCGGGTGCTGCCGCACACCGTGCCCAAC
CAGATCCTGCGGTTCATGGACGCCAAACGCCGGGTGCTCGCCGAAATGGCCCCGCCCGACGCGCGTTTCGGCTGGCCGAA
GCGAAACGGATTCGTGCAACCGCTCGTCGACGCCGAACTGCTGGCCGGACTGGACCGGTTCGCGCACGTGCAGGTGCGCT
GGGGCAGCCCGATGACGGGCTGCCGGGAAGACGCCGACGGGGTGAACGTCGAACTCGGCGCCGACGGCGGCAATGTCGGC
GATGGCGGCGGTGACGGCCACCCTGCCCGGCTGCGCGCCCGCTACGTCGTCGGTTGCGACGGCGGGCGCAGCATGACCCG
GCGGGTGATGGGGGTGTCCTTCGACGGCACGACGTCGTCGACCCGGTGGCTGGTGGTCGACATCGCCAACGATCCGCTCG
GGCATCCCAACAGTGAGGTCGGCGCCGACCCCGAACGTCCGTACGCCTCGATCTCGATCGCGCACGGAATTCGCCGCTTC
GAGTTCATGATTCACGCCGACGAGTCCGACGAACAGGCCGAAGACCCGGAATTCCTGACGCGGATGCTGGCCCGGATGGT
GCCGCACCCCGACCGGGTCGACGTGATCCGGCGCCGGGTGTACACCCACCATTCGCGGATCGCCGGCGAGTTCCGCCGAG
GCCGGCTGCTGCTGGCCGGCGACGCCGCGCACCTGATGCCGGTCTGGCAGGGACAGGGCTACAACAGCGGGATCCGCGAC
GCGGCGAACCTGGGCTGGAAGCTCGCCGCGGTGGTGAGCGGGCGGGCCGGCGACAAGCTGCTGGACACCTACGACATGGA
GCGCCGCAAGCATGCCCGCGCGATGATCGACCTGTCCACGATGGTAGGCCGGGTCATCTCACCCACCAACCGCCGGGTGG
CCGGCGCCCGCGACCTGCTGGTGCGCTCGGCGTCGATCGTGCCGACGCTCAAGCGGTATGTGCTGGAGATGCGGTTCAAG
CCCATGCCGCGTTACGAGCAAGGCGCCGTCGTGCACGCCAACCCCGGCCGGGCCGACTCCCCGGTGGGCACGCTGTTCAT
CCAGCCGCGGGTGGACACCCGCGACCAGCAGGACGTGCTGCTCGACGACGTGCTGGGCCCCTGGTTCGCCGTGCTGTGCT
GGAACAACAACCCGCGCAAGATCCTCGGCGAGACGGCGTTCGCGAACTGGAAAGCCTTGGGCGCCCGCTTCTTTGCGCTG
CGCCCGGCCACACAGTTGCACTGGACCGGGCACGACGATCCCGACGTCGTGGTCGTCGGCGACCGGCGCGGTGACCTCAA
ATCCTGGTTCGACACCCACGCTGAATCGGTGCTGTTCCTGCGTCCCGATCGATGCATCGCCGGCGCCTGCATCGCACAGC
GCGCGCCCGACCTGAGCGCGGCGCTGTTCGACGCGCTGACGCTCACGCCGCGAGGAGGTGATCCGCAAAGTGGCACTGGC
TCTGTGCTGTATGTCGCACAGCCCGCTCCTGAATCTTCCGGGGCCGTCGCGGGACCTGCTTGA

Upstream 100 bases:

>100_bases
GCGCGCGTTTCGAAGTGATGCCCGGCTGCGGTCATTGGCCGCAGTACGAGGACGCCAAGACGTTCAATCGGCTGCATCTC
GATTTCCTGCTGGGCCGCTG

Downstream 100 bases:

>100_bases
CGACATCGACGCCGCCATCGCCCGGGCGCGAGGCTTCGTCGAAGACTACGACCCGCAGCTCGTGGTCATCTTTTCACCGG
ACCACTACAACGGGTTCTTC

Product: 3-(3-hydroxyphenyl)propionate hydroxylase

Products: NA

Alternate protein names: 3-HCI hydroxylase; 3-HPP hydroxylase [H]

Number of amino acids: Translated: 580; Mature: 580

Protein sequence:

>580_residues
MIAPGPRATDHDTDVLVVGAGPVGLTLANILGLQGIRTVVVEERDTLIDYPRGVGLDDEALRTFQSIGLVERVLPHTVPN
QILRFMDAKRRVLAEMAPPDARFGWPKRNGFVQPLVDAELLAGLDRFAHVQVRWGSPMTGCREDADGVNVELGADGGNVG
DGGGDGHPARLRARYVVGCDGGRSMTRRVMGVSFDGTTSSTRWLVVDIANDPLGHPNSEVGADPERPYASISIAHGIRRF
EFMIHADESDEQAEDPEFLTRMLARMVPHPDRVDVIRRRVYTHHSRIAGEFRRGRLLLAGDAAHLMPVWQGQGYNSGIRD
AANLGWKLAAVVSGRAGDKLLDTYDMERRKHARAMIDLSTMVGRVISPTNRRVAGARDLLVRSASIVPTLKRYVLEMRFK
PMPRYEQGAVVHANPGRADSPVGTLFIQPRVDTRDQQDVLLDDVLGPWFAVLCWNNNPRKILGETAFANWKALGARFFAL
RPATQLHWTGHDDPDVVVVGDRRGDLKSWFDTHAESVLFLRPDRCIAGACIAQRAPDLSAALFDALTLTPRGGDPQSGTG
SVLYVAQPAPESSGAVAGPA

Sequences:

>Translated_580_residues
MIAPGPRATDHDTDVLVVGAGPVGLTLANILGLQGIRTVVVEERDTLIDYPRGVGLDDEALRTFQSIGLVERVLPHTVPN
QILRFMDAKRRVLAEMAPPDARFGWPKRNGFVQPLVDAELLAGLDRFAHVQVRWGSPMTGCREDADGVNVELGADGGNVG
DGGGDGHPARLRARYVVGCDGGRSMTRRVMGVSFDGTTSSTRWLVVDIANDPLGHPNSEVGADPERPYASISIAHGIRRF
EFMIHADESDEQAEDPEFLTRMLARMVPHPDRVDVIRRRVYTHHSRIAGEFRRGRLLLAGDAAHLMPVWQGQGYNSGIRD
AANLGWKLAAVVSGRAGDKLLDTYDMERRKHARAMIDLSTMVGRVISPTNRRVAGARDLLVRSASIVPTLKRYVLEMRFK
PMPRYEQGAVVHANPGRADSPVGTLFIQPRVDTRDQQDVLLDDVLGPWFAVLCWNNNPRKILGETAFANWKALGARFFAL
RPATQLHWTGHDDPDVVVVGDRRGDLKSWFDTHAESVLFLRPDRCIAGACIAQRAPDLSAALFDALTLTPRGGDPQSGTG
SVLYVAQPAPESSGAVAGPA
>Mature_580_residues
MIAPGPRATDHDTDVLVVGAGPVGLTLANILGLQGIRTVVVEERDTLIDYPRGVGLDDEALRTFQSIGLVERVLPHTVPN
QILRFMDAKRRVLAEMAPPDARFGWPKRNGFVQPLVDAELLAGLDRFAHVQVRWGSPMTGCREDADGVNVELGADGGNVG
DGGGDGHPARLRARYVVGCDGGRSMTRRVMGVSFDGTTSSTRWLVVDIANDPLGHPNSEVGADPERPYASISIAHGIRRF
EFMIHADESDEQAEDPEFLTRMLARMVPHPDRVDVIRRRVYTHHSRIAGEFRRGRLLLAGDAAHLMPVWQGQGYNSGIRD
AANLGWKLAAVVSGRAGDKLLDTYDMERRKHARAMIDLSTMVGRVISPTNRRVAGARDLLVRSASIVPTLKRYVLEMRFK
PMPRYEQGAVVHANPGRADSPVGTLFIQPRVDTRDQQDVLLDDVLGPWFAVLCWNNNPRKILGETAFANWKALGARFFAL
RPATQLHWTGHDDPDVVVVGDRRGDLKSWFDTHAESVLFLRPDRCIAGACIAQRAPDLSAALFDALTLTPRGGDPQSGTG
SVLYVAQPAPESSGAVAGPA

Specific function: Catalyzes the insertion of one atom of molecular oxygen into position 2 of the phenyl ring of 3-(3- hydroxyphenyl)propionate (3-HPP) and hydroxycinnamic acid (3HCI) [H]

COG id: COG0654

COG function: function code HC; 2-polyprenyl-6-methoxyphenol hydroxylase and related FAD-dependent oxidoreductases

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the pheA/tfdB FAD monooxygenase family [H]

Homologues:

Organism=Escherichia coli, GI1786543, Length=543, Percent_Identity=46.7771639042357, Blast_Score=508, Evalue=1e-145,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR002938
- InterPro:   IPR003042 [H]

Pfam domain/function: PF01494 FAD_binding_3 [H]

EC number: 1.14.13.-

Molecular weight: Translated: 63347; Mature: 63347

Theoretical pI: Translated: 7.27; Mature: 7.27

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.9 %Cys     (Translated Protein)
2.6 %Met     (Translated Protein)
3.4 %Cys+Met (Translated Protein)
0.9 %Cys     (Mature Protein)
2.6 %Met     (Mature Protein)
3.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MIAPGPRATDHDTDVLVVGAGPVGLTLANILGLQGIRTVVVEERDTLIDYPRGVGLDDEA
CCCCCCCCCCCCCCEEEEECCHHHHHHHHHHHHCCCEEEEEECCCHHHCCCCCCCCCHHH
LRTFQSIGLVERVLPHTVPNQILRFMDAKRRVLAEMAPPDARFGWPKRNGFVQPLVDAEL
HHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCHHHHHH
LAGLDRFAHVQVRWGSPMTGCREDADGVNVELGADGGNVGDGGGDGHPARLRARYVVGCD
HHHHHHHEEEEEEECCCCCCCCCCCCCCEEEECCCCCCCCCCCCCCCCCEEEEEEEEECC
GGRSMTRRVMGVSFDGTTSSTRWLVVDIANDPLGHPNSEVGADPERPYASISIAHGIRRF
CCHHHHHHHHEEEECCCCCCCEEEEEEECCCCCCCCCCCCCCCCCCCCEEEEHHHHHEEE
EFMIHADESDEQAEDPEFLTRMLARMVPHPDRVDVIRRRVYTHHSRIAGEFRRGRLLLAG
EEEEECCCCCCCCCCHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHCCEEEEEC
DAAHLMPVWQGQGYNSGIRDAANLGWKLAAVVSGRAGDKLLDTYDMERRKHARAMIDLST
CHHHEEEEECCCCCCCCCCHHHHCCEEEEEEECCCCCCHHHHHHHHHHHHHHHHHHHHHH
MVGRVISPTNRRVAGARDLLVRSASIVPTLKRYVLEMRFKPMPRYEQGAVVHANPGRADS
HHHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCEEEECCCCCCCC
PVGTLFIQPRVDTRDQQDVLLDDVLGPWFAVLCWNNNPRKILGETAFANWKALGARFFAL
CCEEEEEECCCCCCCCHHHHHHHHHCCEEEEEEECCCCHHHHCCHHHHHHHHHCEEEEEE
RPATQLHWTGHDDPDVVVVGDRRGDLKSWFDTHAESVLFLRPDRCIAGACIAQRAPDLSA
CCCCEEEECCCCCCCEEEECCCCCCHHHHHHHCCCEEEEECCCCHHHHHHHHHCCCCHHH
ALFDALTLTPRGGDPQSGTGSVLYVAQPAPESSGAVAGPA
HHHHHEEECCCCCCCCCCCCCEEEEECCCCCCCCCCCCCC
>Mature Secondary Structure
MIAPGPRATDHDTDVLVVGAGPVGLTLANILGLQGIRTVVVEERDTLIDYPRGVGLDDEA
CCCCCCCCCCCCCCEEEEECCHHHHHHHHHHHHCCCEEEEEECCCHHHCCCCCCCCCHHH
LRTFQSIGLVERVLPHTVPNQILRFMDAKRRVLAEMAPPDARFGWPKRNGFVQPLVDAEL
HHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCHHHHHH
LAGLDRFAHVQVRWGSPMTGCREDADGVNVELGADGGNVGDGGGDGHPARLRARYVVGCD
HHHHHHHEEEEEEECCCCCCCCCCCCCCEEEECCCCCCCCCCCCCCCCCEEEEEEEEECC
GGRSMTRRVMGVSFDGTTSSTRWLVVDIANDPLGHPNSEVGADPERPYASISIAHGIRRF
CCHHHHHHHHEEEECCCCCCCEEEEEEECCCCCCCCCCCCCCCCCCCCEEEEHHHHHEEE
EFMIHADESDEQAEDPEFLTRMLARMVPHPDRVDVIRRRVYTHHSRIAGEFRRGRLLLAG
EEEEECCCCCCCCCCHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHCCEEEEEC
DAAHLMPVWQGQGYNSGIRDAANLGWKLAAVVSGRAGDKLLDTYDMERRKHARAMIDLST
CHHHEEEEECCCCCCCCCCHHHHCCEEEEEEECCCCCCHHHHHHHHHHHHHHHHHHHHHH
MVGRVISPTNRRVAGARDLLVRSASIVPTLKRYVLEMRFKPMPRYEQGAVVHANPGRADS
HHHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCEEEECCCCCCCC
PVGTLFIQPRVDTRDQQDVLLDDVLGPWFAVLCWNNNPRKILGETAFANWKALGARFFAL
CCEEEEEECCCCCCCCHHHHHHHHHCCEEEEEEECCCCHHHHCCHHHHHHHHHCEEEEEE
RPATQLHWTGHDDPDVVVVGDRRGDLKSWFDTHAESVLFLRPDRCIAGACIAQRAPDLSA
CCCCEEEECCCCCCCEEEECCCCCCHHHHHHHCCCEEEEECCCCHHHHHHHHHCCCCHHH
ALFDALTLTPRGGDPQSGTGSVLYVAQPAPESSGAVAGPA
HHHHHEEECCCCCCCCCCCCCEEEEECCCCCCCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA