Definition Thermococcus onnurineus NA1, complete genome.
Accession NC_011529
Length 1,847,607

Click here to switch to the map view.

The map label for this gene is aegA [H]

Identifier: 212224487

GI number: 212224487

Start: 1208759

End: 1210210

Strand: Reverse

Name: aegA [H]

Synonym: TON_1336

Alternate gene names: 212224487

Gene position: 1210210-1208759 (Counterclockwise)

Preceding gene: 212224488

Following gene: 212224484

Centisome position: 65.5

GC content: 55.44

Gene sequence:

>1452_bases
ATGGCCCTTAAGAGAAAGCTCATTAAGGAACGCGTTCCGACTCCCGAGATCCCGGTTGGGGAAAGGATAAATTCATTCAA
AGAAGTCAATCTTGGTTATACCTTCGAGCTGGCCGTTAAGGAGGCCGAGCGCTGCCTTCAGTGTCCATACAACTATGCAC
CCTGTATCAAGGGATGTCCTGTTCACATCGACATTCCAGGATTCATAAGCAAGCTCGTTGAGTACCGTGACAACCCTGAC
AAGGCCGTTAAGGAGGCTCTCAACGTCATCTGGGCCTGCAACTCTCTGCCGGCAACCACCGGTCGTGTCTGCCCTCAGGA
GGATCAGTGTGAGATGAACTGTGTTATGGGCAAAGTTGGTGACAAGATAAACATCGGCAAGCTCGAGAGGTTTGTCGCCG
ACTACGCGAGGGAGCACGGCATAGACGAGGAGCTTCTCTTTGAGATAGTACCCAAGATAGAGAAGAAGGGCCAGAAAGTT
GCAATCATCGGAGCCGGTCCGGCTGGACTTACCGCCGCTGGCGAGCTGGCCAAGCTCGGCTACGACGTCACAATCTACGA
GGCTCTCCACGAGGCCGGTGGAGTCCTTATGTACGGCATTCCAGAGTTCAGGCTGCCTAAGGAGATAGTCCAGAGCGAGA
TTGAAAAGCTCAAGAAGCTCGGTGTGAAAATCCTGACTGACCACATCGTCGGAAAGACCGTCACCATGGAAGAGTTGCTC
GAGGAGTACGACGCCGTCTTTATTGGCTCCGGAGCTGGAACGCCGAGGTTCATCAACGCTCCAGGAATTAACCTCAACGG
CATCTACTCGGCCAACGAGTTCCTGACCAGGGTCAACCTCATGAAGGCCTATAAGTTCCCGGAGTACGACACGCCCGTCA
AAGTCGGCAAGCGTGTTATAGTCATTGGTGCCGGAAACACCGGAATGGACGCAGCGAGGAGCGCGAGGCGCTTCGGCGCC
GAGGTCATCATCGCCTACAGGCGCGGTCCCGAGGATGTAAGTGCCCGTGTCGAGGAGGTTGAGCACGCCAAGGAGGAGGG
CATCAAGTTCGAGTTCTTCCTCAACCCGGTCGAGTTCATAGGCGACGGCAAGGGCAACCTCAAGGCGGTTAAGTTCGAGA
AGATGAGGCCGCTCGATAAGCGCGATAGCAGGGGCAAGAGGAAGATAGTCGGCACCGGCGAGTACGTCACCATCGAGACC
GACACGGTCATCATAGCCATAGGCAAGCATCCAAACAGGCTCATCGTCAACACGCCCGGCCTGAAGGTCGAGCGCGGTAA
GATAGTCGTCGACGAGAACCTCATGACGAGCATTCCAGGGGTCTTCGCCGGTGGCGATGCGATAAGGGGCGAAGCAACGG
TTATCCTTGCCATGGGTGACGGAAGGAGGGCTGCCAAAGCCATCCATGAGTATCTGACGAAGAAGAGGGAAGAACAGAGA
GAGAATGCCTGA

Upstream 100 bases:

>100_bases
TCGCGTGGGACGAGCTCATAGCGAGGAGCGGTTACTATACTGACCTGGAGGCGAAGGCCATGCAGGAGTACATGAAAGCC
CTCCAGGGAGGTGGGCAGTG

Downstream 100 bases:

>100_bases
GCTCTTTTCTGTTCTTCTCAACTTTCCTCTTACGACTACTATCTCATGCTTCTGCCATAGAAGTTGCGGCACCTTTATCA
ATTCCCTGGCGAATGAAACT

Product: putative oxidoreductase

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 483; Mature: 482

Protein sequence:

>483_residues
MALKRKLIKERVPTPEIPVGERINSFKEVNLGYTFELAVKEAERCLQCPYNYAPCIKGCPVHIDIPGFISKLVEYRDNPD
KAVKEALNVIWACNSLPATTGRVCPQEDQCEMNCVMGKVGDKINIGKLERFVADYAREHGIDEELLFEIVPKIEKKGQKV
AIIGAGPAGLTAAGELAKLGYDVTIYEALHEAGGVLMYGIPEFRLPKEIVQSEIEKLKKLGVKILTDHIVGKTVTMEELL
EEYDAVFIGSGAGTPRFINAPGINLNGIYSANEFLTRVNLMKAYKFPEYDTPVKVGKRVIVIGAGNTGMDAARSARRFGA
EVIIAYRRGPEDVSARVEEVEHAKEEGIKFEFFLNPVEFIGDGKGNLKAVKFEKMRPLDKRDSRGKRKIVGTGEYVTIET
DTVIIAIGKHPNRLIVNTPGLKVERGKIVVDENLMTSIPGVFAGGDAIRGEATVILAMGDGRRAAKAIHEYLTKKREEQR
ENA

Sequences:

>Translated_483_residues
MALKRKLIKERVPTPEIPVGERINSFKEVNLGYTFELAVKEAERCLQCPYNYAPCIKGCPVHIDIPGFISKLVEYRDNPD
KAVKEALNVIWACNSLPATTGRVCPQEDQCEMNCVMGKVGDKINIGKLERFVADYAREHGIDEELLFEIVPKIEKKGQKV
AIIGAGPAGLTAAGELAKLGYDVTIYEALHEAGGVLMYGIPEFRLPKEIVQSEIEKLKKLGVKILTDHIVGKTVTMEELL
EEYDAVFIGSGAGTPRFINAPGINLNGIYSANEFLTRVNLMKAYKFPEYDTPVKVGKRVIVIGAGNTGMDAARSARRFGA
EVIIAYRRGPEDVSARVEEVEHAKEEGIKFEFFLNPVEFIGDGKGNLKAVKFEKMRPLDKRDSRGKRKIVGTGEYVTIET
DTVIIAIGKHPNRLIVNTPGLKVERGKIVVDENLMTSIPGVFAGGDAIRGEATVILAMGDGRRAAKAIHEYLTKKREEQR
ENA
>Mature_482_residues
ALKRKLIKERVPTPEIPVGERINSFKEVNLGYTFELAVKEAERCLQCPYNYAPCIKGCPVHIDIPGFISKLVEYRDNPDK
AVKEALNVIWACNSLPATTGRVCPQEDQCEMNCVMGKVGDKINIGKLERFVADYAREHGIDEELLFEIVPKIEKKGQKVA
IIGAGPAGLTAAGELAKLGYDVTIYEALHEAGGVLMYGIPEFRLPKEIVQSEIEKLKKLGVKILTDHIVGKTVTMEELLE
EYDAVFIGSGAGTPRFINAPGINLNGIYSANEFLTRVNLMKAYKFPEYDTPVKVGKRVIVIGAGNTGMDAARSARRFGAE
VIIAYRRGPEDVSARVEEVEHAKEEGIKFEFFLNPVEFIGDGKGNLKAVKFEKMRPLDKRDSRGKRKIVGTGEYVTIETD
TVIIAIGKHPNRLIVNTPGLKVERGKIVVDENLMTSIPGVFAGGDAIRGEATVILAMGDGRRAAKAIHEYLTKKREEQRE
NA

Specific function: Unknown

COG id: COG0493

COG function: function code ER; NADPH-dependent glutamate synthase beta chain and related oxidoreductases

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 4 4Fe-4S ferredoxin-type domains [H]

Homologues:

Organism=Homo sapiens, GI119943098, Length=463, Percent_Identity=34.341252699784, Blast_Score=196, Evalue=3e-50,
Organism=Escherichia coli, GI1788811, Length=464, Percent_Identity=36.4224137931034, Blast_Score=256, Evalue=2e-69,
Organism=Escherichia coli, GI1789606, Length=475, Percent_Identity=34.1052631578947, Blast_Score=244, Evalue=7e-66,
Organism=Escherichia coli, GI87082180, Length=469, Percent_Identity=32.8358208955224, Blast_Score=223, Evalue=3e-59,
Organism=Escherichia coli, GI1788468, Length=454, Percent_Identity=34.3612334801762, Blast_Score=216, Evalue=2e-57,
Organism=Escherichia coli, GI1789243, Length=420, Percent_Identity=35.4761904761905, Blast_Score=198, Evalue=6e-52,
Organism=Caenorhabditis elegans, GI17570289, Length=483, Percent_Identity=29.8136645962733, Blast_Score=190, Evalue=1e-48,
Organism=Caenorhabditis elegans, GI71984108, Length=471, Percent_Identity=33.9702760084926, Blast_Score=171, Evalue=8e-43,
Organism=Caenorhabditis elegans, GI17543860, Length=208, Percent_Identity=26.4423076923077, Blast_Score=77, Evalue=2e-14,
Organism=Saccharomyces cerevisiae, GI6320030, Length=474, Percent_Identity=30.379746835443, Blast_Score=186, Evalue=6e-48,
Organism=Drosophila melanogaster, GI24665547, Length=496, Percent_Identity=31.25, Blast_Score=195, Evalue=7e-50,
Organism=Drosophila melanogaster, GI24665543, Length=496, Percent_Identity=31.25, Blast_Score=195, Evalue=7e-50,
Organism=Drosophila melanogaster, GI28574881, Length=496, Percent_Identity=31.25, Blast_Score=194, Evalue=9e-50,
Organism=Drosophila melanogaster, GI24665539, Length=496, Percent_Identity=31.25, Blast_Score=194, Evalue=9e-50,
Organism=Drosophila melanogaster, GI24640763, Length=477, Percent_Identity=32.4947589098532, Blast_Score=179, Evalue=3e-45,
Organism=Drosophila melanogaster, GI18858217, Length=477, Percent_Identity=32.4947589098532, Blast_Score=179, Evalue=3e-45,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR001450
- InterPro:   IPR017896
- InterPro:   IPR017900
- InterPro:   IPR013027
- InterPro:   IPR012285
- InterPro:   IPR006006 [H]

Pfam domain/function: PF00037 Fer4; PF07992 Pyr_redox_2 [H]

EC number: NA

Molecular weight: Translated: 53316; Mature: 53184

Theoretical pI: Translated: 7.98; Mature: 7.98

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.7 %Cys     (Translated Protein)
2.1 %Met     (Translated Protein)
3.7 %Cys+Met (Translated Protein)
1.7 %Cys     (Mature Protein)
1.9 %Met     (Mature Protein)
3.5 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MALKRKLIKERVPTPEIPVGERINSFKEVNLGYTFELAVKEAERCLQCPYNYAPCIKGCP
CCHHHHHHHHCCCCCCCCCHHHHCCHHHCCCCEEEEHHHHHHHHHHHCCCCCCCCCCCCE
VHIDIPGFISKLVEYRDNPDKAVKEALNVIWACNSLPATTGRVCPQEDQCEMNCVMGKVG
EEEECHHHHHHHHHHCCCHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCHHHHHHCCC
DKINIGKLERFVADYAREHGIDEELLFEIVPKIEKKGQKVAIIGAGPAGLTAAGELAKLG
CCCCHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHCCCEEEEEECCCCCCCCHHHHHHCC
YDVTIYEALHEAGGVLMYGIPEFRLPKEIVQSEIEKLKKLGVKILTDHIVGKTVTMEELL
CCCHHHHHHHHHCCEEEECCCCCCCCHHHHHHHHHHHHHCCHHHHHHHHCCCEECHHHHH
EEYDAVFIGSGAGTPRFINAPGINLNGIYSANEFLTRVNLMKAYKFPEYDTPVKVGKRVI
HHHCEEEEECCCCCCEEEECCCCCCCEEECHHHHHHHHHHHHHHCCCCCCCCHHHCCEEE
VIGAGNTGMDAARSARRFGAEVIIAYRRGPEDVSARVEEVEHAKEEGIKFEFFLNPVEFI
EEECCCCCHHHHHHHHHCCCEEEEEECCCCHHHHHHHHHHHHHHHCCCEEEEEECHHHHH
GDGKGNLKAVKFEKMRPLDKRDSRGKRKIVGTGEYVTIETDTVIIAIGKHPNRLIVNTPG
CCCCCCEEEEEEHHCCCCCCCCCCCCEEEEECCCEEEEECCEEEEEECCCCCEEEEECCC
LKVERGKIVVDENLMTSIPGVFAGGDAIRGEATVILAMGDGRRAAKAIHEYLTKKREEQR
CEEECCEEEECCCHHHHCCCEEECCCCCCCCEEEEEEECCCHHHHHHHHHHHHHHHHHHH
ENA
CCC
>Mature Secondary Structure 
ALKRKLIKERVPTPEIPVGERINSFKEVNLGYTFELAVKEAERCLQCPYNYAPCIKGCP
CHHHHHHHHCCCCCCCCCHHHHCCHHHCCCCEEEEHHHHHHHHHHHCCCCCCCCCCCCE
VHIDIPGFISKLVEYRDNPDKAVKEALNVIWACNSLPATTGRVCPQEDQCEMNCVMGKVG
EEEECHHHHHHHHHHCCCHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCHHHHHHCCC
DKINIGKLERFVADYAREHGIDEELLFEIVPKIEKKGQKVAIIGAGPAGLTAAGELAKLG
CCCCHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHCCCEEEEEECCCCCCCCHHHHHHCC
YDVTIYEALHEAGGVLMYGIPEFRLPKEIVQSEIEKLKKLGVKILTDHIVGKTVTMEELL
CCCHHHHHHHHHCCEEEECCCCCCCCHHHHHHHHHHHHHCCHHHHHHHHCCCEECHHHHH
EEYDAVFIGSGAGTPRFINAPGINLNGIYSANEFLTRVNLMKAYKFPEYDTPVKVGKRVI
HHHCEEEEECCCCCCEEEECCCCCCCEEECHHHHHHHHHHHHHHCCCCCCCCHHHCCEEE
VIGAGNTGMDAARSARRFGAEVIIAYRRGPEDVSARVEEVEHAKEEGIKFEFFLNPVEFI
EEECCCCCHHHHHHHHHCCCEEEEEECCCCHHHHHHHHHHHHHHHCCCEEEEEECHHHHH
GDGKGNLKAVKFEKMRPLDKRDSRGKRKIVGTGEYVTIETDTVIIAIGKHPNRLIVNTPG
CCCCCCEEEEEEHHCCCCCCCCCCCCEEEEECCCEEEEECCEEEEEECCCCCEEEEECCC
LKVERGKIVVDENLMTSIPGVFAGGDAIRGEATVILAMGDGRRAAKAIHEYLTKKREEQR
CEEECCEEEECCCHHHHCCCEEECCCCCCCCEEEEEEECCCHHHHHHHHHHHHHHHHHHH
ENA
CCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 8955321; 9205837; 9278503 [H]