Definition Agrobacterium vitis S4 plasmid pAtS4e, complete sequence.
Accession NC_011981
Length 631,775

Click here to switch to the map view.

The map label for this gene is mhpA [H]

Identifier: 222102741

GI number: 222102741

Start: 395057

End: 396568

Strand: Reverse

Name: mhpA [H]

Synonym: Avi_7425

Alternate gene names: 222102741

Gene position: 396568-395057 (Counterclockwise)

Preceding gene: 222102742

Following gene: 222102734

Centisome position: 62.77

GC content: 56.81

Gene sequence:

>1512_bases
ATGGTAGGGTCAGTTGATGTCGTCATTGTGGGGTTGGGTCCAACAGGTGCCACCTTGGCAAACCTGCTGTGCAGCATGGA
CCTGACGGTATGCATCGTTGAGGCCGATGAAACGATGTTTACGCTGCCGCGCGCGACCCATTTTGATGGGGAGGTGATGC
GGGTGTTTCAAACACTCGGGCTTGCAGACAAGATCAAGCCCGACACACACGTCAATCCCGGCATGACCTTTATCAACGCA
CAGCACGAAGTCATCCTGCACTGGCCGCGTCCCGCCGAAATGGGGCCGCAGAACTGGCATGGAAGTTATCGCTTTCACCA
ACCCGCACTGGAAACGGTGTTGCGGGAGGGCCTCAATCGCTTCCCGCAAGCAAAGGTATTATCCGGCTGTGAAGTCGTTT
CACTGGAACAGGGCGAAGACGGCGTTGTCGCACAATACCGCACGCGCAAGACTGGTGAAACCGCATCAATCAAAGGCCGT
TACCTTGTTGGATGTGACGGCGGACGATCGCCTGTTCGTGGCATGATCTCGAGCCAGCTTGAGGATCTCGGAAGCCATGA
ACGTTGGATCGTGGTCGATCTGCTGATGAACCGGGATGTTGACGGCCTGACGGACGGTACGGTTCAATTTTGCAACCCGG
TGCGCCCCACGACCTTCATGCGTTGCGTCAAGAACCGACGCCGGTGGGAGTTTATGGTGATGCCCGGGGATGATCTTGAA
CAGCTTCTGACACCTGAGGGTATTTGGGGGCTCCTTTCTCCCTGGCTGACGCCCGATGATGGCGAGATCGAGCGTGCGGT
GACCTATTTCTTCCACGCTGTCATGGCCAAGCCATGGCGGGTGGATCGCGTGCTTCTTGCCGGAGATGCCGCGCACCAGA
CACCACCTTTCCTTGGTCAGGGGCTTTGTGCTGGCATCAGGGACAGTTCCAACCTCGCCTGGAAGCTCGCCAGCGTGATC
AAAGGCACCGCATCGGAGGAGCTCCTCGATACGTATGAACAGGAACGAGCACCACACGTTCGCAAATATATCGAGAATGC
CATTCAGATCGGCAGCATCATTCAGACAGTTGACCCTGAACTGGCGCGAGAGAGAGATGAGAATCTGGCCAAGGGTGGAC
GGTTTATCACCTCAATCAACGCGCAACTTGGTGAGGGATTGCACGGATCAGAACCGCTCCCGGCAGGCATGATTTCGCGG
CAACCGATCCTCACGTCCGGTCGCCCGCTAGATGACGTAGTCGGCAATGCTTTCGTGGTTCTTGGGGCGCAGGATGTGCT
GGACAAGGTATCGCAAGACACGCGCAGGCGATGGCATGACGTCGGCTTGGTCTGCCTTGCTGATGAGGGCGGAGACTATT
TGGCTGAGATTGGCGCGATGGCCATTATCATTCGGCCCGACCGTTACATTTTGGGGATCGCCAATAGCCCGCAAGACCTT
GACCGTATCTCAGAATTGCTTCCCACTTTGGGTCAGCAGACAGACATGATTGGGATGGCGGCGCAAAGGTAA

Upstream 100 bases:

>100_bases
ATAGACAATTCACTGACACCCAAAACGGTGGCAGACCATGACAGGGAAGACATGCAAAACGCCGGAATCATATCGGCCGC
AGAACTGGAGAGGAGAGATT

Downstream 100 bases:

>100_bases
AATTTCCATCGGCAGCCTTCTTGAGGCCGTTCAGCGTCACCGATCTGGATGCTAAATGGCCTCAATTTCATTGGATCTGG
CTTTACATATGGATCGGATC

Product: 3-(3-hydroxyphenyl)propionate hydroxylase

Products: NA

Alternate protein names: 3-HCI hydroxylase; 3-HPP hydroxylase [H]

Number of amino acids: Translated: 503; Mature: 503

Protein sequence:

>503_residues
MVGSVDVVIVGLGPTGATLANLLCSMDLTVCIVEADETMFTLPRATHFDGEVMRVFQTLGLADKIKPDTHVNPGMTFINA
QHEVILHWPRPAEMGPQNWHGSYRFHQPALETVLREGLNRFPQAKVLSGCEVVSLEQGEDGVVAQYRTRKTGETASIKGR
YLVGCDGGRSPVRGMISSQLEDLGSHERWIVVDLLMNRDVDGLTDGTVQFCNPVRPTTFMRCVKNRRRWEFMVMPGDDLE
QLLTPEGIWGLLSPWLTPDDGEIERAVTYFFHAVMAKPWRVDRVLLAGDAAHQTPPFLGQGLCAGIRDSSNLAWKLASVI
KGTASEELLDTYEQERAPHVRKYIENAIQIGSIIQTVDPELARERDENLAKGGRFITSINAQLGEGLHGSEPLPAGMISR
QPILTSGRPLDDVVGNAFVVLGAQDVLDKVSQDTRRRWHDVGLVCLADEGGDYLAEIGAMAIIIRPDRYILGIANSPQDL
DRISELLPTLGQQTDMIGMAAQR

Sequences:

>Translated_503_residues
MVGSVDVVIVGLGPTGATLANLLCSMDLTVCIVEADETMFTLPRATHFDGEVMRVFQTLGLADKIKPDTHVNPGMTFINA
QHEVILHWPRPAEMGPQNWHGSYRFHQPALETVLREGLNRFPQAKVLSGCEVVSLEQGEDGVVAQYRTRKTGETASIKGR
YLVGCDGGRSPVRGMISSQLEDLGSHERWIVVDLLMNRDVDGLTDGTVQFCNPVRPTTFMRCVKNRRRWEFMVMPGDDLE
QLLTPEGIWGLLSPWLTPDDGEIERAVTYFFHAVMAKPWRVDRVLLAGDAAHQTPPFLGQGLCAGIRDSSNLAWKLASVI
KGTASEELLDTYEQERAPHVRKYIENAIQIGSIIQTVDPELARERDENLAKGGRFITSINAQLGEGLHGSEPLPAGMISR
QPILTSGRPLDDVVGNAFVVLGAQDVLDKVSQDTRRRWHDVGLVCLADEGGDYLAEIGAMAIIIRPDRYILGIANSPQDL
DRISELLPTLGQQTDMIGMAAQR
>Mature_503_residues
MVGSVDVVIVGLGPTGATLANLLCSMDLTVCIVEADETMFTLPRATHFDGEVMRVFQTLGLADKIKPDTHVNPGMTFINA
QHEVILHWPRPAEMGPQNWHGSYRFHQPALETVLREGLNRFPQAKVLSGCEVVSLEQGEDGVVAQYRTRKTGETASIKGR
YLVGCDGGRSPVRGMISSQLEDLGSHERWIVVDLLMNRDVDGLTDGTVQFCNPVRPTTFMRCVKNRRRWEFMVMPGDDLE
QLLTPEGIWGLLSPWLTPDDGEIERAVTYFFHAVMAKPWRVDRVLLAGDAAHQTPPFLGQGLCAGIRDSSNLAWKLASVI
KGTASEELLDTYEQERAPHVRKYIENAIQIGSIIQTVDPELARERDENLAKGGRFITSINAQLGEGLHGSEPLPAGMISR
QPILTSGRPLDDVVGNAFVVLGAQDVLDKVSQDTRRRWHDVGLVCLADEGGDYLAEIGAMAIIIRPDRYILGIANSPQDL
DRISELLPTLGQQTDMIGMAAQR

Specific function: Catalyzes the insertion of one atom of molecular oxygen into position 2 of the phenyl ring of 3-(3- hydroxyphenyl)propionate (3-HPP) and hydroxycinnamic acid (3HCI) [H]

COG id: COG0654

COG function: function code HC; 2-polyprenyl-6-methoxyphenol hydroxylase and related FAD-dependent oxidoreductases

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the pheA/tfdB FAD monooxygenase family [H]

Homologues:

Organism=Escherichia coli, GI1786543, Length=534, Percent_Identity=32.3970037453184, Blast_Score=230, Evalue=2e-61,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR002938
- InterPro:   IPR003042 [H]

Pfam domain/function: PF01494 FAD_binding_3 [H]

EC number: 1.14.13.-

Molecular weight: Translated: 55435; Mature: 55435

Theoretical pI: Translated: 4.98; Mature: 4.98

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.6 %Cys     (Translated Protein)
3.2 %Met     (Translated Protein)
4.8 %Cys+Met (Translated Protein)
1.6 %Cys     (Mature Protein)
3.2 %Met     (Mature Protein)
4.8 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MVGSVDVVIVGLGPTGATLANLLCSMDLTVCIVEADETMFTLPRATHFDGEVMRVFQTLG
CCCCEEEEEEECCCCHHHHHHHHHHCCEEEEEEECCCCEEECCCCCCCCHHHHHHHHHHC
LADKIKPDTHVNPGMTFINAQHEVILHWPRPAEMGPQNWHGSYRFHQPALETVLREGLNR
CHHCCCCCCCCCCCCEEEECCCEEEEECCCCCCCCCCCCCCCCEECHHHHHHHHHHHHHH
FPQAKVLSGCEVVSLEQGEDGVVAQYRTRKTGETASIKGRYLVGCDGGRSPVRGMISSQL
CCCHHHHCCCCEEEECCCCCCCEEEEECCCCCCCCEECCCEEEECCCCCCHHHHHHHHHH
EDLGSHERWIVVDLLMNRDVDGLTDGTVQFCNPVRPTTFMRCVKNRRRWEFMVMPGDDLE
HHCCCCCCEEEEEEECCCCCCCCCCCCHHHCCCCCHHHHHHHHHCCCCEEEEEECCCCHH
QLLTPEGIWGLLSPWLTPDDGEIERAVTYFFHAVMAKPWRVDRVLLAGDAAHQTPPFLGQ
HHHCCCCCHHHHCCCCCCCCCHHHHHHHHHHHHHHCCCCCCCEEEEECCCCCCCCCCHHC
GLCAGIRDSSNLAWKLASVIKGTASEELLDTYEQERAPHVRKYIENAIQIGSIIQTVDPE
CHHCCCCCCCCHHHHHHHHHCCCCHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHCCHH
LARERDENLAKGGRFITSINAQLGEGLHGSEPLPAGMISRQPILTSGRPLDDVVGNAFVV
HHHHHHHHHHHCCCEEEEECHHHCCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHCCEEEE
LGAQDVLDKVSQDTRRRWHDVGLVCLADEGGDYLAEIGAMAIIIRPDRYILGIANSPQDL
ECCHHHHHHHHHHHHHHHHHCCEEEEECCCCHHHHHHCCEEEEECCCEEEEEECCCCHHH
DRISELLPTLGQQTDMIGMAAQR
HHHHHHHHHCCCCCCHHHHCCCC
>Mature Secondary Structure
MVGSVDVVIVGLGPTGATLANLLCSMDLTVCIVEADETMFTLPRATHFDGEVMRVFQTLG
CCCCEEEEEEECCCCHHHHHHHHHHCCEEEEEEECCCCEEECCCCCCCCHHHHHHHHHHC
LADKIKPDTHVNPGMTFINAQHEVILHWPRPAEMGPQNWHGSYRFHQPALETVLREGLNR
CHHCCCCCCCCCCCCEEEECCCEEEEECCCCCCCCCCCCCCCCEECHHHHHHHHHHHHHH
FPQAKVLSGCEVVSLEQGEDGVVAQYRTRKTGETASIKGRYLVGCDGGRSPVRGMISSQL
CCCHHHHCCCCEEEECCCCCCCEEEEECCCCCCCCEECCCEEEECCCCCCHHHHHHHHHH
EDLGSHERWIVVDLLMNRDVDGLTDGTVQFCNPVRPTTFMRCVKNRRRWEFMVMPGDDLE
HHCCCCCCEEEEEEECCCCCCCCCCCCHHHCCCCCHHHHHHHHHCCCCEEEEEECCCCHH
QLLTPEGIWGLLSPWLTPDDGEIERAVTYFFHAVMAKPWRVDRVLLAGDAAHQTPPFLGQ
HHHCCCCCHHHHCCCCCCCCCHHHHHHHHHHHHHHCCCCCCCEEEEECCCCCCCCCCHHC
GLCAGIRDSSNLAWKLASVIKGTASEELLDTYEQERAPHVRKYIENAIQIGSIIQTVDPE
CHHCCCCCCCCHHHHHHHHHCCCCHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHCCHH
LARERDENLAKGGRFITSINAQLGEGLHGSEPLPAGMISRQPILTSGRPLDDVVGNAFVV
HHHHHHHHHHHCCCEEEEECHHHCCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHCCEEEE
LGAQDVLDKVSQDTRRRWHDVGLVCLADEGGDYLAEIGAMAIIIRPDRYILGIANSPQDL
ECCHHHHHHHHHHHHHHHHHCCEEEEECCCCHHHHHHCCEEEEECCCEEEEEECCCCHHH
DRISELLPTLGQQTDMIGMAAQR
HHHHHHHHHCCCCCCHHHHCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA