| Definition | Escherichia coli HS, complete genome. |
|---|---|
| Accession | NC_009800 |
| Length | 4,643,538 |
Click here to switch to the map view.
The map label for this gene is fumA [H]
Identifier: 157161073
GI number: 157161073
Start: 1708865
End: 1710511
Strand: Reverse
Name: fumA [H]
Synonym: EcHS_A1687
Alternate gene names: 157161073
Gene position: 1710511-1708865 (Counterclockwise)
Preceding gene: 157161076
Following gene: 157161072
Centisome position: 36.84
GC content: 50.64
Gene sequence:
>1647_bases ATGTCAAACAAACCCTTTCATTATCAGGCTCCTTTTCCACTCAAAAAAGATGATACTGAGTATTACCTGCTAACCAGCGA ACACGTTAGCGTATCTGAATTTGAAGGGCAGGAGATTTTGAAAGTCGCACCCGAAGCGTTAACTCTGTTGGCGCGTCAGG CGTTTCATGATGCGTCGTTTATGCTGCGTCCGGCTCACCAACAACAGGTGGCCGACATTCTGCGTGACCCGGAGGCCAGC GAAAATGATAAATATGTGGCGCTGCAATTCCTGCGTAACTCCGACATCGCGGCGAAAGGCGTTCTGCCAACCTGTCAGGA TACCGGCACTGCGATTATTGTTGGTAAAAAAGGGCAGCGTGTATGGACCGGTGGCTGTGATGAAGCGGCGCTGGCGCGCG GTGTCTATAACACTTATATCGAAGATAATTTGCGCTACTCGCAAAACGCGCCGCTGGATATGTATAAAGAGGTGAATACC GGCACCAATCTGCCAGCGCAGATCGATCTTTATGCCGTTGATGGCGACGAGTACAAATTCCTCTGTATCGCCAAAGGTGG TGGTTCGGCAAACAAGACGTATCTCTATCAGGAAACCAAAGCGTTACTAACGCCGGGGAAACTGAAAAATTACCTGGTTG AGAAGATGCGCACGCTGGGTACGGCGGCCTGTCCTCCGTATCATATTGCGTTCGTAATTGGTGGAACTTCTGCAGAAACT AACCTTAAAACAGTGAAACTGGCTTCCGCTAAATACTATGACGAACTGCCAACGGAAGGGAATGAGCACGGTCAGGCATT CCGCGATGTGGAACTGGAAAAAGAATTGCTGATCGAAGCGCAAAATCTCGGTCTGGGTGCGCAGTTTGGTGGTAAATACT TCGCTCACGACATACGCGTGATTCGCCTGCCACGTCACGGCGCATCCTGTCCGGTTGGTATGGGTGTTTCCTGCTCTGCT GACCGTAATATCAAAGCGAAGATCAACCGTCAGGGGATCTGGATCGAAAAACTGGAACATAATCCAGGTAAATATATCCC TGAAGAGCTGCGTAAAGCGGGAGAAGGCGAAGCGGTGCGCGTTGACCTTAACCGTCCGATGAAAGAGATCCTCGCACAGT TGTCGCAGTATCCCGTTTCTACACGCTTATCGCTTAACGGCACGATTATCGTCGGTCGTGATATTGCTCACGCCAAACTG AAAGAGCGGATGGATAACGGTGAAGGGCTGCCGCAGTACATTAAAGATCATCCGATTTACTACGCGGGTCCGGCCAAAAC GCCGGAAGGTTATGCCTCCGGTTCTCTTGGCCCAACGACCGCCGGACGGATGGATTCTTATGTCGATCAACTGCAAGCGC AGGGCGGAAGTATGATCATGCTGGCGAAAGGCAACCGCAGCCAGCAGGTGACGGATGCCTGTAAAAAACACGGCGGCTTC TACCTTGGCAGTATCGGTGGTCCGGCCGCTGTATTGGCGCAGGGAAGTATTAAGAGCCTGGAATGTGTTGAATATCCGGA ACTGGGAATGGAAGCCATCTGGAAAATTGAAGTGGAAGATTTCCCGGCGTTTATCCTTGTGGATGATAAAGGAAATGACT TCTTCCAGCAGATACAACTCACACAGTGCACTCGCTGTGTGAAATAA
Upstream 100 bases:
>100_bases TTTTGTTAAAAAAGTGTGTAGGATATTGTTACTCGCTTTTAACAGGGCAACGGAACACCCGCCCAGAGCATAACCAAACC AGGCAGTAAGTGAGAGAACA
Downstream 100 bases:
>100_bases ACAGAGCCGCCCTTCGGGGCGGTTTTTTTACATGGCACGAAAGACCAAACATTTGTTATCAAATAGTAAATAATAAGTGA GCTAAAAGTTGCTTAACGAA
Product: fumarate hydratase
Products: NA
Alternate protein names: Fumarase [H]
Number of amino acids: Translated: 548; Mature: 547
Protein sequence:
>548_residues MSNKPFHYQAPFPLKKDDTEYYLLTSEHVSVSEFEGQEILKVAPEALTLLARQAFHDASFMLRPAHQQQVADILRDPEAS ENDKYVALQFLRNSDIAAKGVLPTCQDTGTAIIVGKKGQRVWTGGCDEAALARGVYNTYIEDNLRYSQNAPLDMYKEVNT GTNLPAQIDLYAVDGDEYKFLCIAKGGGSANKTYLYQETKALLTPGKLKNYLVEKMRTLGTAACPPYHIAFVIGGTSAET NLKTVKLASAKYYDELPTEGNEHGQAFRDVELEKELLIEAQNLGLGAQFGGKYFAHDIRVIRLPRHGASCPVGMGVSCSA DRNIKAKINRQGIWIEKLEHNPGKYIPEELRKAGEGEAVRVDLNRPMKEILAQLSQYPVSTRLSLNGTIIVGRDIAHAKL KERMDNGEGLPQYIKDHPIYYAGPAKTPEGYASGSLGPTTAGRMDSYVDQLQAQGGSMIMLAKGNRSQQVTDACKKHGGF YLGSIGGPAAVLAQGSIKSLECVEYPELGMEAIWKIEVEDFPAFILVDDKGNDFFQQIQLTQCTRCVK
Sequences:
>Translated_548_residues MSNKPFHYQAPFPLKKDDTEYYLLTSEHVSVSEFEGQEILKVAPEALTLLARQAFHDASFMLRPAHQQQVADILRDPEAS ENDKYVALQFLRNSDIAAKGVLPTCQDTGTAIIVGKKGQRVWTGGCDEAALARGVYNTYIEDNLRYSQNAPLDMYKEVNT GTNLPAQIDLYAVDGDEYKFLCIAKGGGSANKTYLYQETKALLTPGKLKNYLVEKMRTLGTAACPPYHIAFVIGGTSAET NLKTVKLASAKYYDELPTEGNEHGQAFRDVELEKELLIEAQNLGLGAQFGGKYFAHDIRVIRLPRHGASCPVGMGVSCSA DRNIKAKINRQGIWIEKLEHNPGKYIPEELRKAGEGEAVRVDLNRPMKEILAQLSQYPVSTRLSLNGTIIVGRDIAHAKL KERMDNGEGLPQYIKDHPIYYAGPAKTPEGYASGSLGPTTAGRMDSYVDQLQAQGGSMIMLAKGNRSQQVTDACKKHGGF YLGSIGGPAAVLAQGSIKSLECVEYPELGMEAIWKIEVEDFPAFILVDDKGNDFFQQIQLTQCTRCVK >Mature_547_residues SNKPFHYQAPFPLKKDDTEYYLLTSEHVSVSEFEGQEILKVAPEALTLLARQAFHDASFMLRPAHQQQVADILRDPEASE NDKYVALQFLRNSDIAAKGVLPTCQDTGTAIIVGKKGQRVWTGGCDEAALARGVYNTYIEDNLRYSQNAPLDMYKEVNTG TNLPAQIDLYAVDGDEYKFLCIAKGGGSANKTYLYQETKALLTPGKLKNYLVEKMRTLGTAACPPYHIAFVIGGTSAETN LKTVKLASAKYYDELPTEGNEHGQAFRDVELEKELLIEAQNLGLGAQFGGKYFAHDIRVIRLPRHGASCPVGMGVSCSAD RNIKAKINRQGIWIEKLEHNPGKYIPEELRKAGEGEAVRVDLNRPMKEILAQLSQYPVSTRLSLNGTIIVGRDIAHAKLK ERMDNGEGLPQYIKDHPIYYAGPAKTPEGYASGSLGPTTAGRMDSYVDQLQAQGGSMIMLAKGNRSQQVTDACKKHGGFY LGSIGGPAAVLAQGSIKSLECVEYPELGMEAIWKIEVEDFPAFILVDDKGNDFFQQIQLTQCTRCVK
Specific function: It functions as an aerobic enzyme in the citric acid cycle. It accounts for about 80% of the fumarase activity when the bacteria grows aerobically [H]
COG id: COG1951
COG function: function code C; Tartrate dehydratase alpha subunit/Fumarate hydratase class I, N-terminal domain
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the class-I fumarase family [H]
Homologues:
Organism=Escherichia coli, GI1787897, Length=548, Percent_Identity=99.8175182481752, Blast_Score=1134, Evalue=0.0, Organism=Escherichia coli, GI1790564, Length=548, Percent_Identity=89.7810218978102, Blast_Score=1025, Evalue=0.0, Organism=Escherichia coli, GI1789443, Length=181, Percent_Identity=28.7292817679558, Blast_Score=78, Evalue=1e-15,
Paralogues:
None
Copy number: 160 Molecules/Cell In: Growth Phase, Minimal Media (Based on E. coli). [C]
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR004646 - InterPro: IPR004647 - InterPro: IPR011167 - InterPro: IPR020557 [H]
Pfam domain/function: PF05681 Fumerase; PF05683 Fumerase_C [H]
EC number: =4.2.1.2 [H]
Molecular weight: Translated: 60345; Mature: 60214
Theoretical pI: Translated: 6.51; Mature: 6.51
Prosite motif: PS00163 FUMARATE_LYASES
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.8 %Cys (Translated Protein) 2.0 %Met (Translated Protein) 3.8 %Cys+Met (Translated Protein) 1.8 %Cys (Mature Protein) 1.8 %Met (Mature Protein) 3.7 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MSNKPFHYQAPFPLKKDDTEYYLLTSEHVSVSEFEGQEILKVAPEALTLLARQAFHDASF CCCCCEEEECCCCCCCCCCCEEEEECCCCCHHHCCCHHHHHHHHHHHHHHHHHHHCCCHH MLRPAHQQQVADILRDPEASENDKYVALQFLRNSDIAAKGVLPTCQDTGTAIIVGKKGQR EECCCHHHHHHHHHCCCCCCCCCCEEEEEEECCCCCEECCCCCCCCCCCCEEEEECCCCE VWTGGCDEAALARGVYNTYIEDNLRYSQNAPLDMYKEVNTGTNLPAQIDLYAVDGDEYKF EEECCCCHHHHHHHHHHHHHHCCCCCCCCCCHHHHHHCCCCCCCCCEEEEEEECCCCEEE LCIAKGGGSANKTYLYQETKALLTPGKLKNYLVEKMRTLGTAACPPYHIAFVIGGTSAET EEEECCCCCCCCEEEEECHHHHCCCHHHHHHHHHHHHHHCCCCCCCEEEEEEEECCCCCC NLKTVKLASAKYYDELPTEGNEHGQAFRDVELEKELLIEAQNLGLGAQFGGKYFAHDIRV CEEEEEEECHHHHHCCCCCCCCCCCHHHHHHHHHHHHEEHHCCCCCCCCCCCEEEECEEE IRLPRHGASCPVGMGVSCSADRNIKAKINRQGIWIEKLEHNPGKYIPEELRKAGEGEAVR EEECCCCCCCCCCCCEECCCCCCEEEEECCCCEEEEEEECCCCCCCCHHHHHCCCCCEEE VDLNRPMKEILAQLSQYPVSTRLSLNGTIIVGRDIAHAKLKERMDNGEGLPQYIKDHPIY EECCCCHHHHHHHHHHCCCEEEEEECEEEEEECCHHHHHHHHHHCCCCCCHHHHHCCCEE YAGPAKTPEGYASGSLGPTTAGRMDSYVDQLQAQGGSMIMLAKGNRSQQVTDACKKHGGF EECCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHCCCCEEEEECCCCCHHHHHHHHHCCCE YLGSIGGPAAVLAQGSIKSLECVEYPELGMEAIWKIEVEDFPAFILVDDKGNDFFQQIQL EEECCCCCEEEEECCCCCCEEECCCCCCCCEEEEEEEECCCCEEEEEECCCCHHHHHHHH TQCTRCVK HHHHHHCC >Mature Secondary Structure SNKPFHYQAPFPLKKDDTEYYLLTSEHVSVSEFEGQEILKVAPEALTLLARQAFHDASF CCCCEEEECCCCCCCCCCCEEEEECCCCCHHHCCCHHHHHHHHHHHHHHHHHHHCCCHH MLRPAHQQQVADILRDPEASENDKYVALQFLRNSDIAAKGVLPTCQDTGTAIIVGKKGQR EECCCHHHHHHHHHCCCCCCCCCCEEEEEEECCCCCEECCCCCCCCCCCCEEEEECCCCE VWTGGCDEAALARGVYNTYIEDNLRYSQNAPLDMYKEVNTGTNLPAQIDLYAVDGDEYKF EEECCCCHHHHHHHHHHHHHHCCCCCCCCCCHHHHHHCCCCCCCCCEEEEEEECCCCEEE LCIAKGGGSANKTYLYQETKALLTPGKLKNYLVEKMRTLGTAACPPYHIAFVIGGTSAET EEEECCCCCCCCEEEEECHHHHCCCHHHHHHHHHHHHHHCCCCCCCEEEEEEEECCCCCC NLKTVKLASAKYYDELPTEGNEHGQAFRDVELEKELLIEAQNLGLGAQFGGKYFAHDIRV CEEEEEEECHHHHHCCCCCCCCCCCHHHHHHHHHHHHEEHHCCCCCCCCCCCEEEECEEE IRLPRHGASCPVGMGVSCSADRNIKAKINRQGIWIEKLEHNPGKYIPEELRKAGEGEAVR EEECCCCCCCCCCCCEECCCCCCEEEEECCCCEEEEEEECCCCCCCCHHHHHCCCCCEEE VDLNRPMKEILAQLSQYPVSTRLSLNGTIIVGRDIAHAKLKERMDNGEGLPQYIKDHPIY EECCCCHHHHHHHHHHCCCEEEEEECEEEEEECCHHHHHHHHHHCCCCCCHHHHHCCCEE YAGPAKTPEGYASGSLGPTTAGRMDSYVDQLQAQGGSMIMLAKGNRSQQVTDACKKHGGF EECCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHCCCCEEEEECCCCCHHHHHHHHHCCCE YLGSIGGPAAVLAQGSIKSLECVEYPELGMEAIWKIEVEDFPAFILVDDKGNDFFQQIQL EEECCCCCEEEEECCCCCCEEECCCCCCCCEEEEEEEECCCCEEEEEECCCCHHHHHHHH TQCTRCVK HHHHHHCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 11677609; 1879695 [H]