Definition Thermoanaerobacter tengcongensis MB4, complete genome.
Accession NC_003869
Length 2,689,445

Click here to switch to the map view.

The map label for this gene is SfcA [H]

Identifier: 20808698

GI number: 20808698

Start: 2213496

End: 2214680

Strand: Reverse

Name: SfcA [H]

Synonym: TTE2332

Alternate gene names: 20808698

Gene position: 2214680-2213496 (Counterclockwise)

Preceding gene: 20808699

Following gene: 20808697

Centisome position: 82.35

GC content: 38.73

Gene sequence:

>1185_bases
ATGGATCTTAAAAAAGAAGCATTAAAACTTCATAGAGAAAATAAAGGGAAAATAGAAGTTGTAAGTAAAGTACCTGTAAA
AAATGAGGAAGACCTTTCTTTAGCTTATACTCCTTATGTAGCAGAGCCGTGTAAAGAAATTGAAAAGGATAAAGACCTGG
TCTATGAATATACTGTGAAAGGACACATGGTAGCAGTAGTTACAGATGGTTCTGCGGTGCTAGGGCTTGGCAATATTGGA
CCTTACGCGGCGCTCCCTGTCATGGAAGGGAAAGCAGTTTTGTTTAAGGAATTTGGCGGTATTGATGCTATTCCAATATG
CCTTGCGACGCAAGATGTAGATGAAATCATAAGAACAGTGCTAAATATCGCTCCTACTTTTGGAGGAATTAACCTTGAGG
ATATTTCTGCTCCTCGTTGTTTTGAAATAGAGAAAAGACTCGATGAAATGCTGGATATACCTGTATTTCACGACGATCAA
CATGGGACAGCTATAGTGACTTTCGCAGCTTTAGTAAATGCCTTAAAAATTGTAAAAAAGTCTCTTTATGAAATTGTTGC
GGTAGTGAATGGAGCTGGAGCGGCAGGTGTTGCTATTTCTAAATTTTTAGTTAATGCTGGGGTAAAAGATGTAATAGTTT
GCGACAGAAGTGGCATCATATATGAAGGAAGAAAAGACCTGGATTCTTCAAAACAAAAGATTGCTAAAATTACCAATAAA
AAGAAAATTAAAGGGACATTGAAGGAGGCTTTAGAAGGTGCTGATGTTTTCATAGGAGTATCAGGACCTAATCTCTTGAC
AAAGGAAATGGTAAAAAAGATGGCTAAAAAACCTATTGTCTTTGCACTGGCTAATCCAGTTCCCGAAATACACCCTGAAG
AGGCAAAAGAAGCGGGAGCTTATGTGGTGGGGACGGGCAGGTCTGACTTTCCTAACCAGGTCAATAATGTGCTGGCTTTT
CCAGGAGTTTTTAAAGGTGCTTTGAGGGTAAGGGCGACTACTATAAACGAAAGGATGAAACTTGCAGCAGCGTATGCTAT
AGCTAATACTATCTCAGAAGAGGAACTTTCGAGTGAATACATACTACCGAAGCCTTTTGATAAAAGGGTAGCTGAGAATG
TGGCTTATGCTGTTGCAAAAGAAGCAATTAATACAGGTGTTTCTAGAATTACTAAATTTGATTAG

Upstream 100 bases:

>100_bases
AAGAAAAAGAAGAAGGCTAAGCCTGCTTAAGCAGGCTTCTTTTTTCTTGAGGGGAAATAAGGTATAATATAAGAAAACCC
TTTTTATTAAGGAGGATTTT

Downstream 100 bases:

>100_bases
AGGTGTTGTGGTATGAAGAAAGGTCAAAAATTTTTTAAAGGCAAACTTTACAAATCCCTTCGCTCAGGTTTTTTTGAAGA
AGAAGTATATGAAGTTTCGA

Product: malic enzyme

Products: NA

Alternate protein names: NAD-ME 4 [H]

Number of amino acids: Translated: 394; Mature: 394

Protein sequence:

>394_residues
MDLKKEALKLHRENKGKIEVVSKVPVKNEEDLSLAYTPYVAEPCKEIEKDKDLVYEYTVKGHMVAVVTDGSAVLGLGNIG
PYAALPVMEGKAVLFKEFGGIDAIPICLATQDVDEIIRTVLNIAPTFGGINLEDISAPRCFEIEKRLDEMLDIPVFHDDQ
HGTAIVTFAALVNALKIVKKSLYEIVAVVNGAGAAGVAISKFLVNAGVKDVIVCDRSGIIYEGRKDLDSSKQKIAKITNK
KKIKGTLKEALEGADVFIGVSGPNLLTKEMVKKMAKKPIVFALANPVPEIHPEEAKEAGAYVVGTGRSDFPNQVNNVLAF
PGVFKGALRVRATTINERMKLAAAYAIANTISEEELSSEYILPKPFDKRVAENVAYAVAKEAINTGVSRITKFD

Sequences:

>Translated_394_residues
MDLKKEALKLHRENKGKIEVVSKVPVKNEEDLSLAYTPYVAEPCKEIEKDKDLVYEYTVKGHMVAVVTDGSAVLGLGNIG
PYAALPVMEGKAVLFKEFGGIDAIPICLATQDVDEIIRTVLNIAPTFGGINLEDISAPRCFEIEKRLDEMLDIPVFHDDQ
HGTAIVTFAALVNALKIVKKSLYEIVAVVNGAGAAGVAISKFLVNAGVKDVIVCDRSGIIYEGRKDLDSSKQKIAKITNK
KKIKGTLKEALEGADVFIGVSGPNLLTKEMVKKMAKKPIVFALANPVPEIHPEEAKEAGAYVVGTGRSDFPNQVNNVLAF
PGVFKGALRVRATTINERMKLAAAYAIANTISEEELSSEYILPKPFDKRVAENVAYAVAKEAINTGVSRITKFD
>Mature_394_residues
MDLKKEALKLHRENKGKIEVVSKVPVKNEEDLSLAYTPYVAEPCKEIEKDKDLVYEYTVKGHMVAVVTDGSAVLGLGNIG
PYAALPVMEGKAVLFKEFGGIDAIPICLATQDVDEIIRTVLNIAPTFGGINLEDISAPRCFEIEKRLDEMLDIPVFHDDQ
HGTAIVTFAALVNALKIVKKSLYEIVAVVNGAGAAGVAISKFLVNAGVKDVIVCDRSGIIYEGRKDLDSSKQKIAKITNK
KKIKGTLKEALEGADVFIGVSGPNLLTKEMVKKMAKKPIVFALANPVPEIHPEEAKEAGAYVVGTGRSDFPNQVNNVLAF
PGVFKGALRVRATTINERMKLAAAYAIANTISEEELSSEYILPKPFDKRVAENVAYAVAKEAINTGVSRITKFD

Specific function: Unknown

COG id: COG0281

COG function: function code C; Malic enzyme

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the malic enzymes family [H]

Homologues:

Organism=Homo sapiens, GI62420882, Length=417, Percent_Identity=26.8585131894484, Blast_Score=102, Evalue=6e-22,
Organism=Homo sapiens, GI62420880, Length=417, Percent_Identity=26.8585131894484, Blast_Score=102, Evalue=6e-22,
Organism=Homo sapiens, GI239049447, Length=417, Percent_Identity=26.8585131894484, Blast_Score=102, Evalue=6e-22,
Organism=Homo sapiens, GI4505145, Length=417, Percent_Identity=26.378896882494, Blast_Score=102, Evalue=9e-22,
Organism=Homo sapiens, GI4505143, Length=436, Percent_Identity=24.5412844036697, Blast_Score=99, Evalue=5e-21,
Organism=Homo sapiens, GI270265879, Length=376, Percent_Identity=26.5957446808511, Blast_Score=87, Evalue=2e-17,
Organism=Escherichia coli, GI1788806, Length=413, Percent_Identity=50.6053268765133, Blast_Score=390, Evalue=1e-110,
Organism=Escherichia coli, GI87081919, Length=445, Percent_Identity=26.0674157303371, Blast_Score=89, Evalue=4e-19,
Organism=Caenorhabditis elegans, GI17537199, Length=411, Percent_Identity=25.3041362530414, Blast_Score=81, Evalue=1e-15,
Organism=Saccharomyces cerevisiae, GI6322823, Length=392, Percent_Identity=25.5102040816327, Blast_Score=84, Evalue=3e-17,
Organism=Drosophila melanogaster, GI78707242, Length=385, Percent_Identity=28.051948051948, Blast_Score=107, Evalue=1e-23,
Organism=Drosophila melanogaster, GI78707238, Length=385, Percent_Identity=28.051948051948, Blast_Score=107, Evalue=1e-23,
Organism=Drosophila melanogaster, GI78707240, Length=384, Percent_Identity=28.3854166666667, Blast_Score=107, Evalue=2e-23,
Organism=Drosophila melanogaster, GI281362672, Length=448, Percent_Identity=27.4553571428571, Blast_Score=100, Evalue=3e-21,
Organism=Drosophila melanogaster, GI281362674, Length=448, Percent_Identity=27.2321428571429, Blast_Score=100, Evalue=3e-21,
Organism=Drosophila melanogaster, GI21356279, Length=448, Percent_Identity=27.2321428571429, Blast_Score=99, Evalue=4e-21,
Organism=Drosophila melanogaster, GI281363503, Length=401, Percent_Identity=25.4364089775561, Blast_Score=94, Evalue=2e-19,
Organism=Drosophila melanogaster, GI281363505, Length=401, Percent_Identity=25.4364089775561, Blast_Score=94, Evalue=2e-19,
Organism=Drosophila melanogaster, GI78707236, Length=401, Percent_Identity=25.4364089775561, Blast_Score=94, Evalue=2e-19,
Organism=Drosophila melanogaster, GI78707232, Length=397, Percent_Identity=25.6926952141058, Blast_Score=93, Evalue=3e-19,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR015884
- InterPro:   IPR012301
- InterPro:   IPR012302
- InterPro:   IPR001891
- InterPro:   IPR016040 [H]

Pfam domain/function: PF00390 malic; PF03949 Malic_M [H]

EC number: =1.1.1.38 [H]

Molecular weight: Translated: 42684; Mature: 42684

Theoretical pI: Translated: 7.04; Mature: 7.04

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.0 %Cys     (Translated Protein)
1.8 %Met     (Translated Protein)
2.8 %Cys+Met (Translated Protein)
1.0 %Cys     (Mature Protein)
1.8 %Met     (Mature Protein)
2.8 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MDLKKEALKLHRENKGKIEVVSKVPVKNEEDLSLAYTPYVAEPCKEIEKDKDLVYEYTVK
CCCHHHHHHHHCCCCCCEEEEEECCCCCCCCCEEEECCHHHHHHHHHCCCCCEEEEEEEC
GHMVAVVTDGSAVLGLGNIGPYAALPVMEGKAVLFKEFGGIDAIPICLATQDVDEIIRTV
CEEEEEEECCCEEEEECCCCCCCCCCCCCCCEEEHHHCCCCCCEEEEEECCCHHHHHHHH
LNIAPTFGGINLEDISAPRCFEIEKRLDEMLDIPVFHDDQHGTAIVTFAALVNALKIVKK
HHHCCCCCCCCHHHCCCCCHHHHHHHHHHHHCCCCEECCCCCHHHHHHHHHHHHHHHHHH
SLYEIVAVVNGAGAAGVAISKFLVNAGVKDVIVCDRSGIIYEGRKDLDSSKQKIAKITNK
HHHHHHHHHCCCCHHHHHHHHHHHHCCCCEEEEECCCCCEECCCCCCCHHHHHHHHHHCH
KKIKGTLKEALEGADVFIGVSGPNLLTKEMVKKMAKKPIVFALANPVPEIHPEEAKEAGA
HHHHHHHHHHCCCCEEEEECCCCCHHHHHHHHHHHHCCEEEEECCCCCCCCCHHHHHCCC
YVVGTGRSDFPNQVNNVLAFPGVFKGALRVRATTINERMKLAAAYAIANTISEEELSSEY
EEEECCCCCCCHHHHHEEECCHHHHHHHEEEEEHHHHHHHHHHHHHHHHHHCHHHHCCCC
ILPKPFDKRVAENVAYAVAKEAINTGVSRITKFD
CCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCC
>Mature Secondary Structure
MDLKKEALKLHRENKGKIEVVSKVPVKNEEDLSLAYTPYVAEPCKEIEKDKDLVYEYTVK
CCCHHHHHHHHCCCCCCEEEEEECCCCCCCCCEEEECCHHHHHHHHHCCCCCEEEEEEEC
GHMVAVVTDGSAVLGLGNIGPYAALPVMEGKAVLFKEFGGIDAIPICLATQDVDEIIRTV
CEEEEEEECCCEEEEECCCCCCCCCCCCCCCEEEHHHCCCCCCEEEEEECCCHHHHHHHH
LNIAPTFGGINLEDISAPRCFEIEKRLDEMLDIPVFHDDQHGTAIVTFAALVNALKIVKK
HHHCCCCCCCCHHHCCCCCHHHHHHHHHHHHCCCCEECCCCCHHHHHHHHHHHHHHHHHH
SLYEIVAVVNGAGAAGVAISKFLVNAGVKDVIVCDRSGIIYEGRKDLDSSKQKIAKITNK
HHHHHHHHHCCCCHHHHHHHHHHHHCCCCEEEEECCCCCEECCCCCCCHHHHHHHHHHCH
KKIKGTLKEALEGADVFIGVSGPNLLTKEMVKKMAKKPIVFALANPVPEIHPEEAKEAGA
HHHHHHHHHHCCCCEEEEECCCCCHHHHHHHHHHHHCCEEEEECCCCCCCCCHHHHHCCC
YVVGTGRSDFPNQVNNVLAFPGVFKGALRVRATTINERMKLAAAYAIANTISEEELSSEY
EEEECCCCCCCHHHHHEEECCHHHHHHHEEEEEHHHHHHHHHHHHHHHHHHCHHHHCCCC
ILPKPFDKRVAENVAYAVAKEAINTGVSRITKFD
CCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 9387221; 9384377 [H]