| Definition | Novosphingobium aromaticivorans DSM 12444 chromosome, complete genome. |
|---|---|
| Accession | NC_007794 |
| Length | 3,561,584 |
Click here to switch to the map view.
The map label for this gene is folD
Identifier: 87201312
GI number: 87201312
Start: 3519973
End: 3520866
Strand: Direct
Name: folD
Synonym: Saro_3300
Alternate gene names: 87201312
Gene position: 3519973-3520866 (Clockwise)
Preceding gene: 87201311
Following gene: 87201313
Centisome position: 98.83
GC content: 67.34
Gene sequence:
>894_bases ATGACTGCTGCCGTTATTGACGGAAAGGCCTTTGCCGCCACGCTGCGCGGGCGCGTCGGCGACCTTGCCACTGCATTCGA GGCCAGGGCCGGTCGCAAGGCGGGGCTTGCCGTGGTGCTGGTGGGCGAGGACCCGGCGAGCCAAGTCTATGTTCGCTCGA AGGGCAAGAGCACGCTCGAAGCGGGCATGGCAAGCTTCGAGCACAAGCTTCCCGCCGACACCGCCGAGGCCGACCTCCTT GCCGTAGTGGAGCAGCTCAACGCCGATCCGGCGGTTGACGGCATTCTCGTCCAGCTTCCCCTGCCCCGGCACATGGACGA GCAGAAGGTCATCGCCGCGATCAATCCCGACAAGGACGTCGATGGCTTCCACGTGATCAACGCGGGCCGCCTCGCCGTCG GCCAGCCGGGCTTCGTGCCCTGCACCCCGCTTGGCTGCCTGATGTTGCTAAAGGACCGACTGGGCGACCTTTCCGGCCTC GATGCCGTGGTAATCGGCCGCTCAAACATCGTCGGCAAGCCGATGGCGCAGTTGCTCATCGCCGAAAGCTGCACCGTCAC GGTCGCGCACAGCCGCACGAAGAACCTCCCGGAAGTCGTGCGCCGCGCGGACATCGTCGTGGCAGCCGTAGGCCGCCCCG AGATGGTCAAGGGCGACTGGATCAAGCCGGGCGCAACCGTGATCGACGTCGGCATCAACCGCGTCCCGGGCAAGGAAGAA GGCAAGACCCGGCTGGTCGGCGACGTCGACTATGCGTCCGCCGCCGAAGTCGCGTCGGCCATCACCCCGGTTCCGGGCGG CGTCGGCCCGATGACCATCGCCGTGCTTCTGCGCAACGCGCTGGTCGCGGCCTACCGCAACGCGGGGATCGACCTTTCCG CCGACGCGATCTGA
Upstream 100 bases:
>100_bases GGTGCTGATCATCGGCCTCAACCTGCTGACGATCCTGCTGAGCGGCGTTGCCGCCTCGGGCGCGGGGCTCTGAAGCCACA CCGGAACGGAACCTATTTCG
Downstream 100 bases:
>100_bases GCTTGGGCCGATCTGGACTTGGGCCGATCTGAAAATGGGCCGATCTGAAATTGGGTATGCGGTCCTGCGCGGGCCGCGCC CTCAAATTCGCTGTCCTACA
Product: bifunctional 5,10-methylene-tetrahydrofolate dehydrogenase/ 5,10-methylene-tetrahydrofolate cyclohydrolase
Products: NA
Alternate protein names: Methylenetetrahydrofolate dehydrogenase; Methenyltetrahydrofolate cyclohydrolase
Number of amino acids: Translated: 297; Mature: 296
Protein sequence:
>297_residues MTAAVIDGKAFAATLRGRVGDLATAFEARAGRKAGLAVVLVGEDPASQVYVRSKGKSTLEAGMASFEHKLPADTAEADLL AVVEQLNADPAVDGILVQLPLPRHMDEQKVIAAINPDKDVDGFHVINAGRLAVGQPGFVPCTPLGCLMLLKDRLGDLSGL DAVVIGRSNIVGKPMAQLLIAESCTVTVAHSRTKNLPEVVRRADIVVAAVGRPEMVKGDWIKPGATVIDVGINRVPGKEE GKTRLVGDVDYASAAEVASAITPVPGGVGPMTIAVLLRNALVAAYRNAGIDLSADAI
Sequences:
>Translated_297_residues MTAAVIDGKAFAATLRGRVGDLATAFEARAGRKAGLAVVLVGEDPASQVYVRSKGKSTLEAGMASFEHKLPADTAEADLL AVVEQLNADPAVDGILVQLPLPRHMDEQKVIAAINPDKDVDGFHVINAGRLAVGQPGFVPCTPLGCLMLLKDRLGDLSGL DAVVIGRSNIVGKPMAQLLIAESCTVTVAHSRTKNLPEVVRRADIVVAAVGRPEMVKGDWIKPGATVIDVGINRVPGKEE GKTRLVGDVDYASAAEVASAITPVPGGVGPMTIAVLLRNALVAAYRNAGIDLSADAI >Mature_296_residues TAAVIDGKAFAATLRGRVGDLATAFEARAGRKAGLAVVLVGEDPASQVYVRSKGKSTLEAGMASFEHKLPADTAEADLLA VVEQLNADPAVDGILVQLPLPRHMDEQKVIAAINPDKDVDGFHVINAGRLAVGQPGFVPCTPLGCLMLLKDRLGDLSGLD AVVIGRSNIVGKPMAQLLIAESCTVTVAHSRTKNLPEVVRRADIVVAAVGRPEMVKGDWIKPGATVIDVGINRVPGKEEG KTRLVGDVDYASAAEVASAITPVPGGVGPMTIAVLLRNALVAAYRNAGIDLSADAI
Specific function: Catalyzes the oxidation of 5,10- methylenetetrahydrofolate to 5,10-methenyltetrahydrofolate and then the hydrolysis of 5,10-methenyltetrahydrofolate to 10- formyltetrahydrofolate
COG id: COG0190
COG function: function code H; 5,10-methylene-tetrahydrofolate dehydrogenase/Methenyl tetrahydrofolate cyclohydrolase
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the tetrahydrofolate dehydrogenase/cyclohydrolase family
Homologues:
Organism=Homo sapiens, GI222136639, Length=290, Percent_Identity=46.551724137931, Blast_Score=244, Evalue=9e-65, Organism=Homo sapiens, GI222418558, Length=294, Percent_Identity=42.5170068027211, Blast_Score=222, Evalue=4e-58, Organism=Homo sapiens, GI94721354, Length=294, Percent_Identity=43.1972789115646, Blast_Score=217, Evalue=1e-56, Organism=Homo sapiens, GI36796743, Length=214, Percent_Identity=28.0373831775701, Blast_Score=80, Evalue=3e-15, Organism=Escherichia coli, GI1786741, Length=284, Percent_Identity=53.8732394366197, Blast_Score=277, Evalue=6e-76, Organism=Caenorhabditis elegans, GI17568735, Length=294, Percent_Identity=45.9183673469388, Blast_Score=227, Evalue=5e-60, Organism=Saccharomyces cerevisiae, GI6319558, Length=288, Percent_Identity=48.9583333333333, Blast_Score=270, Evalue=2e-73, Organism=Saccharomyces cerevisiae, GI6321643, Length=301, Percent_Identity=44.5182724252492, Blast_Score=236, Evalue=4e-63, Organism=Drosophila melanogaster, GI62472483, Length=289, Percent_Identity=47.7508650519031, Blast_Score=251, Evalue=3e-67, Organism=Drosophila melanogaster, GI45551871, Length=289, Percent_Identity=47.7508650519031, Blast_Score=251, Evalue=3e-67, Organism=Drosophila melanogaster, GI24645718, Length=289, Percent_Identity=47.7508650519031, Blast_Score=251, Evalue=4e-67, Organism=Drosophila melanogaster, GI17137370, Length=289, Percent_Identity=47.7508650519031, Blast_Score=251, Evalue=4e-67, Organism=Drosophila melanogaster, GI17136818, Length=295, Percent_Identity=46.1016949152542, Blast_Score=247, Evalue=8e-66, Organism=Drosophila melanogaster, GI17136816, Length=295, Percent_Identity=46.1016949152542, Blast_Score=246, Evalue=1e-65,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): FOLD_NOVAD (Q2G338)
Other databases:
- EMBL: CP000248 - RefSeq: YP_498569.1 - ProteinModelPortal: Q2G338 - SMR: Q2G338 - STRING: Q2G338 - GeneID: 3915947 - GenomeReviews: CP000248_GR - KEGG: nar:Saro_3300 - NMPDR: fig|48935.1.peg.3892 - eggNOG: COG0190 - HOGENOM: HBG328751 - OMA: CLMMLRD - PhylomeDB: Q2G338 - ProtClustDB: PRK14188 - BioCyc: NARO279238:SARO_3300-MONOMER - GO: GO:0005488 - HAMAP: MF_01576 - InterPro: IPR016040 - InterPro: IPR000672 - InterPro: IPR020630 - InterPro: IPR020867 - InterPro: IPR020631 - Gene3D: G3DSA:3.40.50.720 - PRINTS: PR00085
Pfam domain/function: PF00763 THF_DHG_CYH; PF02882 THF_DHG_CYH_C
EC number: =1.5.1.5; =3.5.4.9
Molecular weight: Translated: 30785; Mature: 30654
Theoretical pI: Translated: 6.14; Mature: 6.14
Prosite motif: PS00766 THF_DHG_CYH_1; PS00767 THF_DHG_CYH_2
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.0 %Cys (Translated Protein) 2.4 %Met (Translated Protein) 3.4 %Cys+Met (Translated Protein) 1.0 %Cys (Mature Protein) 2.0 %Met (Mature Protein) 3.0 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MTAAVIDGKAFAATLRGRVGDLATAFEARAGRKAGLAVVLVGEDPASQVYVRSKGKSTLE CCEEEECCHHHHHHHHCCHHHHHHHHHHHCCCCCCEEEEEECCCCCCEEEEECCCCHHHH AGMASFEHKLPADTAEADLLAVVEQLNADPAVDGILVQLPLPRHMDEQKVIAAINPDKDV HHHHHHHHCCCCCCHHHHHHHHHHHHCCCCCCCCEEEEECCCCCCCCCCEEEEECCCCCC DGFHVINAGRLAVGQPGFVPCTPLGCLMLLKDRLGDLSGLDAVVIGRSNIVGKPMAQLLI CCEEEEECCEEEECCCCCCCCCHHHHHHHHHHHHCCCCCCCEEEEECCCCCCCHHHHHHH AESCTVTVAHSRTKNLPEVVRRADIVVAAVGRPEMVKGDWIKPGATVIDVGINRVPGKEE HCCCEEEEECCCCCCHHHHHHHHCEEEEECCCCCCCCCCCCCCCCEEEEECCCCCCCCCC GKTRLVGDVDYASAAEVASAITPVPGGVGPMTIAVLLRNALVAAYRNAGIDLSADAI CCEEEEECCCHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHCCCCCCCCCCC >Mature Secondary Structure TAAVIDGKAFAATLRGRVGDLATAFEARAGRKAGLAVVLVGEDPASQVYVRSKGKSTLE CEEEECCHHHHHHHHCCHHHHHHHHHHHCCCCCCEEEEEECCCCCCEEEEECCCCHHHH AGMASFEHKLPADTAEADLLAVVEQLNADPAVDGILVQLPLPRHMDEQKVIAAINPDKDV HHHHHHHHCCCCCCHHHHHHHHHHHHCCCCCCCCEEEEECCCCCCCCCCEEEEECCCCCC DGFHVINAGRLAVGQPGFVPCTPLGCLMLLKDRLGDLSGLDAVVIGRSNIVGKPMAQLLI CCEEEEECCEEEECCCCCCCCCHHHHHHHHHHHHCCCCCCCEEEEECCCCCCCHHHHHHH AESCTVTVAHSRTKNLPEVVRRADIVVAAVGRPEMVKGDWIKPGATVIDVGINRVPGKEE HCCCEEEEECCCCCCHHHHHHHHCEEEEECCCCCCCCCCCCCCCCEEEEECCCCCCCCCC GKTRLVGDVDYASAAEVASAITPVPGGVGPMTIAVLLRNALVAAYRNAGIDLSADAI CCEEEEECCCHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHCCCCCCCCCCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 10.0
TargetDB status: NA
Availability: NA
References: NA