| Definition | Agrobacterium vitis S4 plasmid pAtS4e, complete sequence. |
|---|---|
| Accession | NC_011981 |
| Length | 631,775 |
Click here to switch to the map view.
The map label for this gene is paaF [C]
Identifier: 222102934
GI number: 222102934
Start: 621801
End: 622601
Strand: Direct
Name: paaF [C]
Synonym: Avi_7690
Alternate gene names: 222102934
Gene position: 621801-622601 (Clockwise)
Preceding gene: 222102933
Following gene: 222102935
Centisome position: 98.42
GC content: 59.8
Gene sequence:
>801_bases ATGATCTATAAAACCCTTGATCTCGAATTGAACGGTGCGGTCGCAACAGTGTGGATGAACCGGCCAGACCTGCACAATGC CTTCGATGAGATGCTCATTGAGGACATGACGCTGGCCATTGAAGCGCTGTCTGAAAACGACAGCGTGCGCGTCCTTGTGC TGGCCGGTCGTGGGGCCAGTTTTTCCGCAGGCGCTGACCTTGCGTGGATGAAGCGGCAAGGTGCTGCTACCCTTGCGGAC AATACGGCGGATGCCGCCGCCATGGGGCGGATGTTCATGGCATTGCGCAATTGTCCCAAGCCGCTGATTGCCCGCATTCA AGGTGCTGCCATTGGCGGTGGAATGGGGCTGGTGGCGGCCTGCGACATTGCTGTTGCCGCTCCCGATGCCGTGTTTGCCA CTTCAGAAGTTCGCCTCGCGCTGATCCCTGCGGTTATCAGCCCGCTGGTTGCTGCTGCGATTGGGGAGCGTCAGTGCCGC CGCTATTTCCTCACGGGGGAGCGGATGGGGGTTGAGAAGGCACATGTGCTGGGCCTTGTGCACGAGATTGCCGAAAAGGA TGGCCTTGACGCTGCTGTGGCGCGGATTGTTGCCGATGTGCTGAAAGGCGCGCCTGGCGCGGTAACAGAGGCGAAGGCGT TGATCACGCAGATTTCCGACCGTCGTTTCGATGAAGCATTGGTGTCTGAAATGGCAGAGCGGATTGCGGCCCGCCGAGGC ACGGATGAAGCCCGCGAGGGTCTTTCGGCCTTTCTGGAAAAACGCAAACCCGGCTGGATCGCGGATCGGAAAGAAGGGTG A
Upstream 100 bases:
>100_bases CCCGCGCAAACCCGCCGGGTTCTCGGCCTTTCCCTGTCAACGGCGCTCAATGCGCCCATCGGTGAAACCCGCTTCGGCCT TTTCCGCATGTGAGATTGCC
Downstream 100 bases:
>100_bases AGGATCAAACCATGTTTCAGAAAATCCTGATCGCCAATCGCGGCGAAATCGCCTGCCGCATTATCCGAACCGCGCGGCGC ATGGGCATTGCCACCGTTGC
Product: Enoyl-CoA hydratase/isomerase family protein
Products: NA
Alternate protein names: 3-hydroxypropionyl-CoA dehydratase [H]
Number of amino acids: Translated: 266; Mature: 266
Protein sequence:
>266_residues MIYKTLDLELNGAVATVWMNRPDLHNAFDEMLIEDMTLAIEALSENDSVRVLVLAGRGASFSAGADLAWMKRQGAATLAD NTADAAAMGRMFMALRNCPKPLIARIQGAAIGGGMGLVAACDIAVAAPDAVFATSEVRLALIPAVISPLVAAAIGERQCR RYFLTGERMGVEKAHVLGLVHEIAEKDGLDAAVARIVADVLKGAPGAVTEAKALITQISDRRFDEALVSEMAERIAARRG TDEAREGLSAFLEKRKPGWIADRKEG
Sequences:
>Translated_266_residues MIYKTLDLELNGAVATVWMNRPDLHNAFDEMLIEDMTLAIEALSENDSVRVLVLAGRGASFSAGADLAWMKRQGAATLAD NTADAAAMGRMFMALRNCPKPLIARIQGAAIGGGMGLVAACDIAVAAPDAVFATSEVRLALIPAVISPLVAAAIGERQCR RYFLTGERMGVEKAHVLGLVHEIAEKDGLDAAVARIVADVLKGAPGAVTEAKALITQISDRRFDEALVSEMAERIAARRG TDEAREGLSAFLEKRKPGWIADRKEG >Mature_266_residues MIYKTLDLELNGAVATVWMNRPDLHNAFDEMLIEDMTLAIEALSENDSVRVLVLAGRGASFSAGADLAWMKRQGAATLAD NTADAAAMGRMFMALRNCPKPLIARIQGAAIGGGMGLVAACDIAVAAPDAVFATSEVRLALIPAVISPLVAAAIGERQCR RYFLTGERMGVEKAHVLGLVHEIAEKDGLDAAVARIVADVLKGAPGAVTEAKALITQISDRRFDEALVSEMAERIAARRG TDEAREGLSAFLEKRKPGWIADRKEG
Specific function: Plays a role in autotrophic carbon fixation via the 3- hydroxypropionate/4-hydroxybutyrate cycle. Catalyzes the reversible dehydration of 3-hydroxypropionyl-CoA to form acryloyl- CoA, and the reversible dehydration of (S)-3-hydroxybutyryl-CoA to form crot
COG id: COG1024
COG function: function code I; Enoyl-CoA hydratase/carnithine racemase
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the enoyl-CoA hydratase/isomerase family [H]
Homologues:
Organism=Homo sapiens, GI194097323, Length=251, Percent_Identity=28.2868525896414, Blast_Score=96, Evalue=4e-20, Organism=Homo sapiens, GI31542718, Length=255, Percent_Identity=27.4509803921569, Blast_Score=92, Evalue=6e-19, Organism=Homo sapiens, GI70995211, Length=136, Percent_Identity=34.5588235294118, Blast_Score=81, Evalue=1e-15, Organism=Homo sapiens, GI45643119, Length=255, Percent_Identity=24.3137254901961, Blast_Score=71, Evalue=1e-12, Organism=Homo sapiens, GI260275230, Length=255, Percent_Identity=24.3137254901961, Blast_Score=71, Evalue=1e-12, Organism=Homo sapiens, GI260274832, Length=255, Percent_Identity=24.3137254901961, Blast_Score=71, Evalue=1e-12, Organism=Escherichia coli, GI1787659, Length=248, Percent_Identity=29.0322580645161, Blast_Score=97, Evalue=1e-21, Organism=Escherichia coli, GI1788597, Length=248, Percent_Identity=25.8064516129032, Blast_Score=89, Evalue=3e-19, Organism=Escherichia coli, GI221142681, Length=266, Percent_Identity=28.9473684210526, Blast_Score=83, Evalue=2e-17, Organism=Escherichia coli, GI87082183, Length=268, Percent_Identity=23.8805970149254, Blast_Score=76, Evalue=2e-15, Organism=Escherichia coli, GI1787660, Length=263, Percent_Identity=29.277566539924, Blast_Score=71, Evalue=9e-14, Organism=Caenorhabditis elegans, GI25145438, Length=254, Percent_Identity=27.9527559055118, Blast_Score=97, Evalue=7e-21, Organism=Caenorhabditis elegans, GI17554946, Length=247, Percent_Identity=30.3643724696356, Blast_Score=95, Evalue=4e-20, Organism=Caenorhabditis elegans, GI17536985, Length=228, Percent_Identity=26.7543859649123, Blast_Score=88, Evalue=5e-18, Organism=Caenorhabditis elegans, GI17540714, Length=222, Percent_Identity=28.3783783783784, Blast_Score=73, Evalue=1e-13, Organism=Caenorhabditis elegans, GI17535521, Length=258, Percent_Identity=24.8062015503876, Blast_Score=73, Evalue=2e-13, Organism=Caenorhabditis elegans, GI25144276, Length=143, Percent_Identity=30.0699300699301, Blast_Score=71, Evalue=6e-13, Organism=Caenorhabditis elegans, GI17508951, Length=143, Percent_Identity=30.0699300699301, Blast_Score=71, Evalue=7e-13, Organism=Caenorhabditis elegans, GI17508953, Length=143, Percent_Identity=30.0699300699301, Blast_Score=71, Evalue=7e-13, Organism=Caenorhabditis elegans, GI17560910, Length=179, Percent_Identity=28.4916201117318, Blast_Score=68, Evalue=5e-12, Organism=Caenorhabditis elegans, GI17534483, Length=136, Percent_Identity=27.9411764705882, Blast_Score=67, Evalue=1e-11, Organism=Caenorhabditis elegans, GI17540306, Length=240, Percent_Identity=24.1666666666667, Blast_Score=65, Evalue=2e-11, Organism=Drosophila melanogaster, GI24653139, Length=273, Percent_Identity=28.9377289377289, Blast_Score=90, Evalue=1e-18, Organism=Drosophila melanogaster, GI20129971, Length=253, Percent_Identity=27.2727272727273, Blast_Score=89, Evalue=4e-18, Organism=Drosophila melanogaster, GI24653477, Length=253, Percent_Identity=27.2727272727273, Blast_Score=89, Evalue=4e-18, Organism=Drosophila melanogaster, GI19920382, Length=212, Percent_Identity=29.7169811320755, Blast_Score=77, Evalue=1e-14, Organism=Drosophila melanogaster, GI24654903, Length=203, Percent_Identity=24.6305418719212, Blast_Score=77, Evalue=1e-14, Organism=Drosophila melanogaster, GI19922422, Length=254, Percent_Identity=21.6535433070866, Blast_Score=65, Evalue=7e-11,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR014748 - InterPro: IPR001753 - InterPro: IPR018376 [H]
Pfam domain/function: PF00378 ECH [H]
EC number: =4.2.1.116 [H]
Molecular weight: Translated: 28283; Mature: 28283
Theoretical pI: Translated: 5.22; Mature: 5.22
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.1 %Cys (Translated Protein) 4.1 %Met (Translated Protein) 5.3 %Cys+Met (Translated Protein) 1.1 %Cys (Mature Protein) 4.1 %Met (Mature Protein) 5.3 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MIYKTLDLELNGAVATVWMNRPDLHNAFDEMLIEDMTLAIEALSENDSVRVLVLAGRGAS CCEEEEEEEECCCEEEEEECCCCHHHHHHHHHHHHHHHHHHHHCCCCCEEEEEEECCCCC FSAGADLAWMKRQGAATLADNTADAAAMGRMFMALRNCPKPLIARIQGAAIGGGMGLVAA CCCCCCHHHHHHCCCCEECCCCHHHHHHHHHHHHHHCCCHHHHHHHCCCCCCCCCHHHHH CDIAVAAPDAVFATSEVRLALIPAVISPLVAAAIGERQCRRYFLTGERMGVEKAHVLGLV HHHHHCCCCHHEECCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHH HEIAEKDGLDAAVARIVADVLKGAPGAVTEAKALITQISDRRFDEALVSEMAERIAARRG HHHHHCCCHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCC TDEAREGLSAFLEKRKPGWIADRKEG CHHHHHHHHHHHHHCCCCCCCCCCCC >Mature Secondary Structure MIYKTLDLELNGAVATVWMNRPDLHNAFDEMLIEDMTLAIEALSENDSVRVLVLAGRGAS CCEEEEEEEECCCEEEEEECCCCHHHHHHHHHHHHHHHHHHHHCCCCCEEEEEEECCCCC FSAGADLAWMKRQGAATLADNTADAAAMGRMFMALRNCPKPLIARIQGAAIGGGMGLVAA CCCCCCHHHHHHCCCCEECCCCHHHHHHHHHHHHHHCCCHHHHHHHCCCCCCCCCHHHHH CDIAVAAPDAVFATSEVRLALIPAVISPLVAAAIGERQCRRYFLTGERMGVEKAHVLGLV HHHHHCCCCHHEECCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHH HEIAEKDGLDAAVARIVADVLKGAPGAVTEAKALITQISDRRFDEALVSEMAERIAARRG HHHHHCCCHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCC TDEAREGLSAFLEKRKPGWIADRKEG CHHHHHHHHHHHHHCCCCCCCCCCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 10.0
TargetDB status: NA
Availability: NA
References: NA