| Definition | Azoarcus sp. BH72 chromosome, complete genome. |
|---|---|
| Accession | NC_008702 |
| Length | 4,376,040 |
Click here to switch to the map view.
The map label for this gene is yfdE [H]
Identifier: 119898214
GI number: 119898214
Start: 2111082
End: 2112305
Strand: Reverse
Name: yfdE [H]
Synonym: azo1923
Alternate gene names: 119898214
Gene position: 2112305-2111082 (Counterclockwise)
Preceding gene: 119898215
Following gene: 119898213
Centisome position: 48.27
GC content: 68.3
Gene sequence:
>1224_bases ATGCCCGGCGCACTTTCCCACATCCGCGTGCTAGACCTCTCCCGCATCCTCGCGGGCCCTTGGGCCGGCCAGTTGCTCGC CGATCTCGGCGCCGACGTCATCAAGGTGGAACGCCCCGGCGCCGGCGACGACACCCGCGGCTGGGGTCCTCCCTTCCTGA AAGACGAACAGGGCGAAAACACACCGGTCGCCGCCTACTACCTCTGCGCCAACCGCAACAAGCGCTCCATCACCATCGAC ATCACCCGGCCGGAAGGCCAGGCGCTGGTGAAACAGCTCGCTGCCGAATCCGACGTGGTGCTGGAAAACTTCAAGCTCGG CGGGCTCGCCCAGTACGGCCTCGACTATGCCGCGCTGAAGGCGATCAACCCGCGCCTCATCTACTGCTCCATCACCGGCT TCGGCCAGGACGGCCCCTACGCACCGCGCGCCGGCTACGACTTCCTGATCCAGGGCCTCGGCGGGCTGATGAGCCTCACC GGCCGCCCGGACGACGAAGAGGGTGGCGGGCCGATGAAGGTCGGCGTCGCGCTCACCGACATCCTCACCGGCCTGTATGC CACCAACGCCGTGCTCGCCGCGCTCGCCTGGCGGGAGAAAAGCGGGGAAGGGCAGTTCATCGACCTCGCGCTGCTCGACG TGCAGATCGCCTGCCTCGCCAACCAGGCGATGAACTACCTCACCACCGGGCAGAACCCCAAGCGGCTGGGCAACGCCCAC CCCAACATCGTGCCCTACCAGGACTTCCCGACCGCCGACGGCTACATGATCCTCGCCATCGGCAACGATGGTCAGTTCGC CCGCTTCTGCACCGAAGCCGGCGCCCCGGAACTCGCCGCCGACCCGCGCTACGCCACCAACAAGGCGCGGGTGGAAAACC GCAACACGCTGATTCCCGCGCTCAAGCGCCTGACCATCGAGCGCAGCACCGCCGACTGGGTCGCCGCACTCGAAGCGCTC GCCGTGCCCTGCGGCCCGATCAACACGCTGGCCGACGTCTTCGCCGACCCGCAGGTGCAGGCCCGCGGCCTCAAGGTCAC GATGCCGCATCCGCTCGCTGGCGAAGTGCCGCTGGTCGCCAACCCCCTACGGCTTTCGGCCACCCCGGTCGAGTACCGCA ACCCGCCCCCGCTGCTCGGCCAACATACCGAGCAGATCCTCAGCACCACGCTCGGCCTCAGCGCAACGCAGATCGAAGAA TTGCGCGCCGCGGGCGTGATCTGA
Upstream 100 bases:
>100_bases AAAAATACCCCGCGCGAGGCGCCAGTCGATAAAAAAGGTTTTCTTAACCCACGTAGAGCAACGACCACATCGTCACAAGA GAACAGCAAGAGACCCCACC
Downstream 100 bases:
>100_bases AACGACAACCCCAGGAGAAAGCGCGCTTGAAGATCCTCGTACCCGTAAAACGCGTGGTTGATTACAACGTGAAAGTCCGC GTGAAGGCGGACGGCAGCGG
Product: hypothetical protein
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 407; Mature: 406
Protein sequence:
>407_residues MPGALSHIRVLDLSRILAGPWAGQLLADLGADVIKVERPGAGDDTRGWGPPFLKDEQGENTPVAAYYLCANRNKRSITID ITRPEGQALVKQLAAESDVVLENFKLGGLAQYGLDYAALKAINPRLIYCSITGFGQDGPYAPRAGYDFLIQGLGGLMSLT GRPDDEEGGGPMKVGVALTDILTGLYATNAVLAALAWREKSGEGQFIDLALLDVQIACLANQAMNYLTTGQNPKRLGNAH PNIVPYQDFPTADGYMILAIGNDGQFARFCTEAGAPELAADPRYATNKARVENRNTLIPALKRLTIERSTADWVAALEAL AVPCGPINTLADVFADPQVQARGLKVTMPHPLAGEVPLVANPLRLSATPVEYRNPPPLLGQHTEQILSTTLGLSATQIEE LRAAGVI
Sequences:
>Translated_407_residues MPGALSHIRVLDLSRILAGPWAGQLLADLGADVIKVERPGAGDDTRGWGPPFLKDEQGENTPVAAYYLCANRNKRSITID ITRPEGQALVKQLAAESDVVLENFKLGGLAQYGLDYAALKAINPRLIYCSITGFGQDGPYAPRAGYDFLIQGLGGLMSLT GRPDDEEGGGPMKVGVALTDILTGLYATNAVLAALAWREKSGEGQFIDLALLDVQIACLANQAMNYLTTGQNPKRLGNAH PNIVPYQDFPTADGYMILAIGNDGQFARFCTEAGAPELAADPRYATNKARVENRNTLIPALKRLTIERSTADWVAALEAL AVPCGPINTLADVFADPQVQARGLKVTMPHPLAGEVPLVANPLRLSATPVEYRNPPPLLGQHTEQILSTTLGLSATQIEE LRAAGVI >Mature_406_residues PGALSHIRVLDLSRILAGPWAGQLLADLGADVIKVERPGAGDDTRGWGPPFLKDEQGENTPVAAYYLCANRNKRSITIDI TRPEGQALVKQLAAESDVVLENFKLGGLAQYGLDYAALKAINPRLIYCSITGFGQDGPYAPRAGYDFLIQGLGGLMSLTG RPDDEEGGGPMKVGVALTDILTGLYATNAVLAALAWREKSGEGQFIDLALLDVQIACLANQAMNYLTTGQNPKRLGNAHP NIVPYQDFPTADGYMILAIGNDGQFARFCTEAGAPELAADPRYATNKARVENRNTLIPALKRLTIERSTADWVAALEALA VPCGPINTLADVFADPQVQARGLKVTMPHPLAGEVPLVANPLRLSATPVEYRNPPPLLGQHTEQILSTTLGLSATQIEEL RAAGVI
Specific function: Unknown
COG id: COG1804
COG function: function code C; Predicted acyl-CoA transferases/carnitine dehydratase
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the CaiB/BaiF CoA-transferase family [H]
Homologues:
Organism=Homo sapiens, GI300863128, Length=403, Percent_Identity=47.394540942928, Blast_Score=370, Evalue=1e-103, Organism=Homo sapiens, GI300863124, Length=429, Percent_Identity=44.5221445221445, Blast_Score=357, Evalue=1e-98, Organism=Homo sapiens, GI13376042, Length=429, Percent_Identity=41.025641025641, Blast_Score=312, Evalue=3e-85, Organism=Homo sapiens, GI300863126, Length=403, Percent_Identity=41.439205955335, Blast_Score=305, Evalue=4e-83, Organism=Homo sapiens, GI42794625, Length=409, Percent_Identity=26.4058679706601, Blast_Score=130, Evalue=2e-30, Organism=Homo sapiens, GI266456254, Length=409, Percent_Identity=26.4058679706601, Blast_Score=130, Evalue=2e-30, Organism=Homo sapiens, GI266458397, Length=211, Percent_Identity=33.6492890995261, Blast_Score=105, Evalue=8e-23, Organism=Homo sapiens, GI266458393, Length=211, Percent_Identity=33.6492890995261, Blast_Score=105, Evalue=9e-23, Organism=Homo sapiens, GI266458395, Length=152, Percent_Identity=35.5263157894737, Blast_Score=92, Evalue=1e-18, Organism=Homo sapiens, GI42822893, Length=152, Percent_Identity=35.5263157894737, Blast_Score=91, Evalue=2e-18, Organism=Escherichia coli, GI87082093, Length=385, Percent_Identity=35.3246753246753, Blast_Score=252, Evalue=3e-68, Organism=Escherichia coli, GI1788717, Length=431, Percent_Identity=30.8584686774942, Blast_Score=182, Evalue=3e-47, Organism=Escherichia coli, GI1786222, Length=417, Percent_Identity=24.4604316546763, Blast_Score=90, Evalue=3e-19, Organism=Caenorhabditis elegans, GI115535051, Length=264, Percent_Identity=26.1363636363636, Blast_Score=70, Evalue=1e-12, Organism=Caenorhabditis elegans, GI32564160, Length=225, Percent_Identity=27.1111111111111, Blast_Score=70, Evalue=2e-12, Organism=Drosophila melanogaster, GI24648431, Length=403, Percent_Identity=46.4019851116625, Blast_Score=357, Evalue=8e-99, Organism=Drosophila melanogaster, GI24585488, Length=352, Percent_Identity=26.9886363636364, Blast_Score=104, Evalue=1e-22,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR003673 [H]
Pfam domain/function: PF02515 CoA_transf_3 [H]
EC number: NA
Molecular weight: Translated: 43413; Mature: 43282
Theoretical pI: Translated: 4.88; Mature: 4.88
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.2 %Cys (Translated Protein) 1.5 %Met (Translated Protein) 2.7 %Cys+Met (Translated Protein) 1.2 %Cys (Mature Protein) 1.2 %Met (Mature Protein) 2.5 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MPGALSHIRVLDLSRILAGPWAGQLLADLGADVIKVERPGAGDDTRGWGPPFLKDEQGEN CCCCCHHHHHHHHHHHHCCCCHHHHHHHCCCCEEEEECCCCCCCCCCCCCCCCCCCCCCC TPVAAYYLCANRNKRSITIDITRPEGQALVKQLAAESDVVLENFKLGGLAQYGLDYAALK CCEEEEEEEECCCCCEEEEEEECCCHHHHHHHHHCCCCEEEECCCCCCHHHHCCCHHHHH AINPRLIYCSITGFGQDGPYAPRAGYDFLIQGLGGLMSLTGRPDDEEGGGPMKVGVALTD HCCCEEEEEEEECCCCCCCCCCCCCHHHHHHHHHHHHCCCCCCCCCCCCCCEEEHHHHHH ILTGLYATNAVLAALAWREKSGEGQFIDLALLDVQIACLANQAMNYLTTGQNPKRLGNAH HHHHHHHHHHHHHHHHHHCCCCCCCEEEEEEHHHHHHHHHHHHHHHHHCCCCHHHHCCCC PNIVPYQDFPTADGYMILAIGNDGQFARFCTEAGAPELAADPRYATNKARVENRNTLIPA CCEECCCCCCCCCCEEEEEECCCCCHHHHHHHCCCCCCCCCCCCCCCCHHHCCCCHHHHH LKRLTIERSTADWVAALEALAVPCGPINTLADVFADPQVQARGLKVTMPHPLAGEVPLVA HHHHHHCCCHHHHHHHHHHHHCCCCCHHHHHHHHCCCCEECCCEEEECCCCCCCCCCEEE NPLRLSATPVEYRNPPPLLGQHTEQILSTTLGLSATQIEELRAAGVI CCCEECCCCCCCCCCCCCCCHHHHHHHHHHHCCCHHHHHHHHHHCCC >Mature Secondary Structure PGALSHIRVLDLSRILAGPWAGQLLADLGADVIKVERPGAGDDTRGWGPPFLKDEQGEN CCCCHHHHHHHHHHHHCCCCHHHHHHHCCCCEEEEECCCCCCCCCCCCCCCCCCCCCCC TPVAAYYLCANRNKRSITIDITRPEGQALVKQLAAESDVVLENFKLGGLAQYGLDYAALK CCEEEEEEEECCCCCEEEEEEECCCHHHHHHHHHCCCCEEEECCCCCCHHHHCCCHHHHH AINPRLIYCSITGFGQDGPYAPRAGYDFLIQGLGGLMSLTGRPDDEEGGGPMKVGVALTD HCCCEEEEEEEECCCCCCCCCCCCCHHHHHHHHHHHHCCCCCCCCCCCCCCEEEHHHHHH ILTGLYATNAVLAALAWREKSGEGQFIDLALLDVQIACLANQAMNYLTTGQNPKRLGNAH HHHHHHHHHHHHHHHHHHCCCCCCCEEEEEEHHHHHHHHHHHHHHHHHCCCCHHHHCCCC PNIVPYQDFPTADGYMILAIGNDGQFARFCTEAGAPELAADPRYATNKARVENRNTLIPA CCEECCCCCCCCCCEEEEEECCCCCHHHHHHHCCCCCCCCCCCCCCCCHHHCCCCHHHHH LKRLTIERSTADWVAALEALAVPCGPINTLADVFADPQVQARGLKVTMPHPLAGEVPLVA HHHHHHCCCHHHHHHHHHHHHCCCCCHHHHHHHHCCCCEECCCEEEECCCCCCCCCCEEE NPLRLSATPVEYRNPPPLLGQHTEQILSTTLGLSATQIEELRAAGVI CCCEECCCCCCCCCCCCCCCHHHHHHHHHHHCCCHHHHHHHHHHCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 9205837; 9278503; 8125343 [H]