| Definition | Frankia sp. EAN1pec chromosome, complete genome. |
|---|---|
| Accession | NC_009921 |
| Length | 8,982,042 |
Click here to switch to the map view.
The map label for this gene is frc [H]
Identifier: 158318095
GI number: 158318095
Start: 7720580
End: 7721821
Strand: Reverse
Name: frc [H]
Synonym: Franean1_6359
Alternate gene names: 158318095
Gene position: 7721821-7720580 (Counterclockwise)
Preceding gene: 158318096
Following gene: 158318094
Centisome position: 85.97
GC content: 68.68
Gene sequence:
>1242_bases ATGAGCAAGCCGGACGGGCCGCTGACAGGCATACGCGTCATCGACTGGACGATCTGGCAGCACGGCCCGGTGGCCGGCGC CATGCTCGGCGATCTCGGCGCGGACGTCATCAAGATCGAGGAGCGGCTCGGTGGCGATTCTGGCCGGGCCCAGTACGCCT TCCCCGACACCGGCACCTCTCCGTACTTCGAGGTCAACAACCGCAACAAGCGCAGCCTCGCCGTCGACCTGAAACGACCC GAGGGGGTGGCGCTGGTACGCCAGCTGGTTGCCCGTTCCGACGTGTTCATCCAGAATTTCCGGCCCACCGTCGCGGAGAA ACTGGGACTGGACTACGAAACGCTGCGCGCCGACAACCCGATGCTCGTCTACGGCGCCGGCAGCGCCTACGGGCCCCACG GCCCCGAGCGGACCGCCCGCGCCTACGACCTGCTTGGCCAGGCCCGCTCCGGCCTGATGCTCAGACCCGGCTCCGACCAG GTCAACGTCGCCGACAGCGGCCTCGCCGACCAGATGGGCGCCATCATGCTCGCCTACGGCGTGCTCGCCGCCCTCCTCGC GCGGGAACGCCACGGGGTGGGCCAGCGGGTCGACACCTCCCTGTTCGGCAGCATGCTCGCCCTGCGCGGCCTGGCGCTCG CCCTCGAGCTCATGACCCAGGACGGACGTGTCGCCACCTCGACGTTCCGCAAGCACCTGGGCGACGAGCCACCCTCACGG GAGAATCCGGGCAACCCGCTGTGGAACTACTACCAGTGCTCGGACGGCAAGCTGATCGCCATGGCCATGGTCCAGTCCGA CCCGCACTGGGCGAACCTCCTCGACGCGCTCGGCAACCCCGAGCCGCTCGCCGGCGACCCCAGGTTCACCGACCACATCA GCCGCTGCCAGAACGCCCGCGCCTGTGTCGCCCTCCTCGACGAGATCTTCGCGGCCGAACCCCGGGACATCTGGCTGCGC CGGCTGCTCGCCACCGGCGACATGCCGATCACCGCGGTGAACACCACCGCCGACATCGTGAACGACCCCCAGGCGATCGC CAACAACTACATCGTCTCATTCGACCACCCCGCGATGGGAAAGACCCGGGTCCCCGGTTTCCCGGTCGCCCTCTCCGAAA CACCGGCGCGCATCCAGCGCCAGGCGCCCGAGTTCGGCGAGCACACCGAGGAGATCCTGATCAACGTGCTGGGACTGACC TGGGACGACATCTCCGACCTGCGCGAACAGGAAATCCTCTAG
Upstream 100 bases:
>100_bases CGGGCAACCCCAAGCACGCGATGCGGCTCGCTTCCACCTACCTGCCCACGATGCGCAAGATAGCCGACGAGTACCGCCGT CAGGGCATCTGGAGCCGGGC
Downstream 100 bases:
>100_bases TGGCGGGCCCGGTGACGGAATTCAGGGCGGGTACCCGCCTTCACAGCGTCACCTGCACGACCGAGGTGATCGTGACCAAG GGAGGAAGCGGCGTTCTCAC
Product: L-carnitine dehydratase/bile acid-inducible protein F
Products: NA
Alternate protein names: Formyl-CoA transferase [H]
Number of amino acids: Translated: 413; Mature: 412
Protein sequence:
>413_residues MSKPDGPLTGIRVIDWTIWQHGPVAGAMLGDLGADVIKIEERLGGDSGRAQYAFPDTGTSPYFEVNNRNKRSLAVDLKRP EGVALVRQLVARSDVFIQNFRPTVAEKLGLDYETLRADNPMLVYGAGSAYGPHGPERTARAYDLLGQARSGLMLRPGSDQ VNVADSGLADQMGAIMLAYGVLAALLARERHGVGQRVDTSLFGSMLALRGLALALELMTQDGRVATSTFRKHLGDEPPSR ENPGNPLWNYYQCSDGKLIAMAMVQSDPHWANLLDALGNPEPLAGDPRFTDHISRCQNARACVALLDEIFAAEPRDIWLR RLLATGDMPITAVNTTADIVNDPQAIANNYIVSFDHPAMGKTRVPGFPVALSETPARIQRQAPEFGEHTEEILINVLGLT WDDISDLREQEIL
Sequences:
>Translated_413_residues MSKPDGPLTGIRVIDWTIWQHGPVAGAMLGDLGADVIKIEERLGGDSGRAQYAFPDTGTSPYFEVNNRNKRSLAVDLKRP EGVALVRQLVARSDVFIQNFRPTVAEKLGLDYETLRADNPMLVYGAGSAYGPHGPERTARAYDLLGQARSGLMLRPGSDQ VNVADSGLADQMGAIMLAYGVLAALLARERHGVGQRVDTSLFGSMLALRGLALALELMTQDGRVATSTFRKHLGDEPPSR ENPGNPLWNYYQCSDGKLIAMAMVQSDPHWANLLDALGNPEPLAGDPRFTDHISRCQNARACVALLDEIFAAEPRDIWLR RLLATGDMPITAVNTTADIVNDPQAIANNYIVSFDHPAMGKTRVPGFPVALSETPARIQRQAPEFGEHTEEILINVLGLT WDDISDLREQEIL >Mature_412_residues SKPDGPLTGIRVIDWTIWQHGPVAGAMLGDLGADVIKIEERLGGDSGRAQYAFPDTGTSPYFEVNNRNKRSLAVDLKRPE GVALVRQLVARSDVFIQNFRPTVAEKLGLDYETLRADNPMLVYGAGSAYGPHGPERTARAYDLLGQARSGLMLRPGSDQV NVADSGLADQMGAIMLAYGVLAALLARERHGVGQRVDTSLFGSMLALRGLALALELMTQDGRVATSTFRKHLGDEPPSRE NPGNPLWNYYQCSDGKLIAMAMVQSDPHWANLLDALGNPEPLAGDPRFTDHISRCQNARACVALLDEIFAAEPRDIWLRR LLATGDMPITAVNTTADIVNDPQAIANNYIVSFDHPAMGKTRVPGFPVALSETPARIQRQAPEFGEHTEEILINVLGLTW DDISDLREQEIL
Specific function: Catalyzes the transfer of the CoA moiety from formyl-CoA to oxalate [H]
COG id: COG1804
COG function: function code C; Predicted acyl-CoA transferases/carnitine dehydratase
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the CaiB/BaiF CoA-transferase family [H]
Homologues:
Organism=Homo sapiens, GI300863128, Length=400, Percent_Identity=31, Blast_Score=175, Evalue=6e-44, Organism=Homo sapiens, GI300863124, Length=426, Percent_Identity=29.1079812206573, Blast_Score=160, Evalue=1e-39, Organism=Homo sapiens, GI13376042, Length=426, Percent_Identity=26.2910798122066, Blast_Score=116, Evalue=4e-26, Organism=Homo sapiens, GI42794625, Length=421, Percent_Identity=26.8408551068884, Blast_Score=112, Evalue=5e-25, Organism=Homo sapiens, GI266456254, Length=421, Percent_Identity=26.8408551068884, Blast_Score=112, Evalue=5e-25, Organism=Homo sapiens, GI300863126, Length=148, Percent_Identity=41.2162162162162, Blast_Score=111, Evalue=1e-24, Organism=Homo sapiens, GI266458397, Length=273, Percent_Identity=30.03663003663, Blast_Score=99, Evalue=7e-21, Organism=Homo sapiens, GI266458393, Length=273, Percent_Identity=30.03663003663, Blast_Score=99, Evalue=9e-21, Organism=Homo sapiens, GI266458395, Length=144, Percent_Identity=35.4166666666667, Blast_Score=77, Evalue=4e-14, Organism=Homo sapiens, GI42822893, Length=144, Percent_Identity=35.4166666666667, Blast_Score=75, Evalue=8e-14, Organism=Escherichia coli, GI87082093, Length=395, Percent_Identity=30.8860759493671, Blast_Score=162, Evalue=3e-41, Organism=Escherichia coli, GI1788717, Length=428, Percent_Identity=29.2056074766355, Blast_Score=125, Evalue=5e-30, Organism=Escherichia coli, GI1786222, Length=420, Percent_Identity=25.2380952380952, Blast_Score=97, Evalue=1e-21, Organism=Caenorhabditis elegans, GI32564160, Length=283, Percent_Identity=28.2685512367491, Blast_Score=86, Evalue=3e-17, Organism=Caenorhabditis elegans, GI115535051, Length=321, Percent_Identity=25.5451713395639, Blast_Score=79, Evalue=4e-15, Organism=Drosophila melanogaster, GI24648431, Length=414, Percent_Identity=30.4347826086957, Blast_Score=161, Evalue=1e-39, Organism=Drosophila melanogaster, GI24585488, Length=198, Percent_Identity=36.3636363636364, Blast_Score=103, Evalue=2e-22,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR003673 - InterPro: IPR017659 [H]
Pfam domain/function: PF02515 CoA_transf_3 [H]
EC number: =2.8.3.16 [H]
Molecular weight: Translated: 45059; Mature: 44927
Theoretical pI: Translated: 4.95; Mature: 4.95
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.7 %Cys (Translated Protein) 2.9 %Met (Translated Protein) 3.6 %Cys+Met (Translated Protein) 0.7 %Cys (Mature Protein) 2.7 %Met (Mature Protein) 3.4 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MSKPDGPLTGIRVIDWTIWQHGPVAGAMLGDLGADVIKIEERLGGDSGRAQYAFPDTGTS CCCCCCCCCCEEEEEEEEECCCCHHHHHHHHHCHHHHHHHHHHCCCCCCEEEECCCCCCC PYFEVNNRNKRSLAVDLKRPEGVALVRQLVARSDVFIQNFRPTVAEKLGLDYETLRADNP CEEEECCCCCCEEEEEECCCCHHHHHHHHHHHHHHHHHHCCHHHHHHHCCCHHHHCCCCC MLVYGAGSAYGPHGPERTARAYDLLGQARSGLMLRPGSDQVNVADSGLADQMGAIMLAYG EEEEECCCCCCCCCCHHHHHHHHHHHHHCCCCEECCCCCCEECCCCCHHHHHHHHHHHHH VLAALLARERHGVGQRVDTSLFGSMLALRGLALALELMTQDGRVATSTFRKHLGDEPPSR HHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHCCCCCCC ENPGNPLWNYYQCSDGKLIAMAMVQSDPHWANLLDALGNPEPLAGDPRFTDHISRCQNAR CCCCCCCCCCEEECCCCEEEEEEECCCCHHHHHHHHCCCCCCCCCCCCHHHHHHHHHCHH ACVALLDEIFAAEPRDIWLRRLLATGDMPITAVNTTADIVNDPQAIANNYIVSFDHPAMG HHHHHHHHHHCCCCHHHHHHHHHHCCCCCEEEECCHHHHCCCCHHHHCCEEEEECCCCCC KTRVPGFPVALSETPARIQRQAPEFGEHTEEILINVLGLTWDDISDLREQEIL CCCCCCCCEECCCCHHHHHHCCCCCCHHHHHHHHHHHCCCHHHHHHHHHHCCC >Mature Secondary Structure SKPDGPLTGIRVIDWTIWQHGPVAGAMLGDLGADVIKIEERLGGDSGRAQYAFPDTGTS CCCCCCCCCEEEEEEEEECCCCHHHHHHHHHCHHHHHHHHHHCCCCCCEEEECCCCCCC PYFEVNNRNKRSLAVDLKRPEGVALVRQLVARSDVFIQNFRPTVAEKLGLDYETLRADNP CEEEECCCCCCEEEEEECCCCHHHHHHHHHHHHHHHHHHCCHHHHHHHCCCHHHHCCCCC MLVYGAGSAYGPHGPERTARAYDLLGQARSGLMLRPGSDQVNVADSGLADQMGAIMLAYG EEEEECCCCCCCCCCHHHHHHHHHHHHHCCCCEECCCCCCEECCCCCHHHHHHHHHHHHH VLAALLARERHGVGQRVDTSLFGSMLALRGLALALELMTQDGRVATSTFRKHLGDEPPSR HHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHCCCCCCC ENPGNPLWNYYQCSDGKLIAMAMVQSDPHWANLLDALGNPEPLAGDPRFTDHISRCQNAR CCCCCCCCCCEEECCCCEEEEEEECCCCHHHHHHHHCCCCCCCCCCCCHHHHHHHHHCHH ACVALLDEIFAAEPRDIWLRRLLATGDMPITAVNTTADIVNDPQAIANNYIVSFDHPAMG HHHHHHHHHHCCCCHHHHHHHHHHCCCCCEEEECCHHHHCCCCHHHHCCEEEEECCCCCC KTRVPGFPVALSETPARIQRQAPEFGEHTEEILINVLGLTWDDISDLREQEIL CCCCCCCCEECCCCHHHHHHCCCCCCHHHHHHHHHHHCCCHHHHHHHHHHCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 12000953 [H]