Definition Escherichia coli O157:H7 str. EC4115, complete genome.
Accession NC_011353
Length 5,572,075

Click here to switch to the map view.

The map label for this gene is aegA [H]

Identifier: 209396864

GI number: 209396864

Start: 3403787

End: 3405766

Strand: Reverse

Name: aegA [H]

Synonym: ECH74115_3689

Alternate gene names: 209396864

Gene position: 3405766-3403787 (Counterclockwise)

Preceding gene: 209399161

Following gene: 209399744

Centisome position: 61.12

GC content: 55.66

Gene sequence:

>1980_bases
ATGAATCGTTTTATTATGGCCAACAGTCAGCAATGTCTGGGTTGTCATGCTTGTGAAATCGCTTGTGTCATGGCTCACAA
TGATGAGCAACATGTCCTGAGCCAACACCATTTTCATCCCCGAATTACGGTTATCAAACATCAGCAGCAACGTAGTGCAG
TGACCTGTCACCATTGTGAAGATGCGCCCTGCGCCCGTAGCTGCCCTAATGGCGCAATCAGCCACGTTGATGACAGCATT
CAGGTCAATCAGCAAAAGTGTATTGGCTGTAAATCCTGCGTGGTGGCCTGTCCGTTTGGTACGATGCAAATCGTCCTGAC
ACCCGTCGCAGCGGGCAAAGTTAAAGCCACGGCGCATAAATGCGACCTTTGTGCAGGGCGCGAAAACGGTCCTGCCTGTG
TCGAGAATTGCCCGGCGGACGCGCTGCAGCTGGTCACTGACGCCGCACTCTCAGGCATGGCGAAATCCCGCCGCTTGCGT
ACCGCACGTCAGGAACATCAACCGTGGCATGCCAGTACCGCTGCACAAGAAATGCCGGTAATGAGTAAAGTCGAACAAAT
GCAGGCAACGCCCGCGCGTGGCGAGCCGGATAAACTGGCGATTGAAGCGCGCAAAACCGGTTTTGATGAAATTTATCTGC
CATTCCGTGCCGATCAGGCACAACGGGAAGCCTCGCGCTGCCTTAAATGCGGCGAGCACAGCGTTTGTGAATGGACCTGC
CCGCTGCATAACCATATACCGCAGTGGATTGAACTGGTGAAAGCCGGAAACATCGACGCCGCCGTCGAGCTTTCTCACCT
GACCAACACCCTGCCGGAAATTACCGGACGCGTTTGTCCGCAAGACCGTTTGTGTGAAGGTGCCTGTACTATTCGCGATG
AGCACGGTGCGGTAACTATCGGCAACATTGAACGCTACATTTCAGATCAGGCGTTGGCGAAAGGTTGGCGTCCTGACTTA
AGCCATGTCACCAAAGTGGACAAGCGGGTGGCGATTATCGGTGCAGGTCCGGCAGGGCTGGCCTGTGCGGATGTTCTGAT
CCGCAATGGCGTGGCGGTGACGGTGTACGATCGCCATCCAGAAATCGGTGGCTTGCTCACTTTCGGCATTCCTTCTTTCA
AACTGGATAAATCCCTGCTGGCACGTCGTCGGGAAATCTTCAGCGCGATGGGGATTCACTTCGAACTCAATTGTGAAGTG
GGTAAAGATGTCTCTTTGGATTCGCTTTTGGAACAATACGACGCGGTCTTCGTTGGCGTAGGCACTTACCGTTCCATGAA
AGCGGGTTTACCCAATGAAGATGCGCCGGGCGTTTATGACGCGCTGCCGTTCCTCATCGCCAACACTAAACAGGTGATGG
GGCTCGAAGAGCTACCGGAAGAGCCGTTTATCAATACCGCCGGACTTAACGTCGTGGTACTGGGCGGCGGCGACACCGCG
ATGGACTGTGTGCGTACTGCGCTGCGCCACGGCGCGAGTAACGTCACCTGCGCTTATCGTCGTGATGAAGCTAACATGCC
AGGCTCGAAGAAAGAGGTGAAGAACGCCCGCGAAGAGGGGGCCAACTTCGAATTTAACGTCCAGCCGGTGGCGCTTGAGC
TGAATGAACAAGGTCACGTCTGCGGGATTCGTTTCCTGCGCACGCGTCTTGGCGAGCCGGATGCCCAGGGGCGTCGGCGT
CCAGTGCCGGTGGAAGGCAGTGAATTTGTCATGCCAGCCGACGCGGTGATTATGGCGTTTGGCTTCAATCCGCACGGGAT
GCCGTGGCTGGAGTCGCACGGTGTAACGGTAGACAAATGGGGCCGCATCATCGCGGATGTGGAAAGCCAGTACCGTTACC
AGACCACCAATCCGAAAATCTTCGCCGGTGGCGACGCCGTGCGTGGTGCGGATCTGGTGGTTACCGCAATGGCAGAAGGA
CGTCATGCGGCACAGGGGATTATTGACTGGCTGGGGGTAAAATCAGTCAAATCTCACTGA

Upstream 100 bases:

>100_bases
TTATTCTGGGCACATGAACATTGCCGATTCCCCTGTAAGTCGGGTAATAACAACACTCATATAAAGAATAAGGTTTTTAC
AACCAAAAAAGAAGGTCGTT

Downstream 100 bases:

>100_bases
TAGCCTGCGCAGACAAACCCGACTTCACAGCGTAATATAATTGTTCATTTCGCGCTGTGGAGTCGGTATGACGCAACAAA
TCACCCTCATTAAAGACAAA

Product: putative oxidoreductase Fe-S binding subunit

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 659; Mature: 659

Protein sequence:

>659_residues
MNRFIMANSQQCLGCHACEIACVMAHNDEQHVLSQHHFHPRITVIKHQQQRSAVTCHHCEDAPCARSCPNGAISHVDDSI
QVNQQKCIGCKSCVVACPFGTMQIVLTPVAAGKVKATAHKCDLCAGRENGPACVENCPADALQLVTDAALSGMAKSRRLR
TARQEHQPWHASTAAQEMPVMSKVEQMQATPARGEPDKLAIEARKTGFDEIYLPFRADQAQREASRCLKCGEHSVCEWTC
PLHNHIPQWIELVKAGNIDAAVELSHLTNTLPEITGRVCPQDRLCEGACTIRDEHGAVTIGNIERYISDQALAKGWRPDL
SHVTKVDKRVAIIGAGPAGLACADVLIRNGVAVTVYDRHPEIGGLLTFGIPSFKLDKSLLARRREIFSAMGIHFELNCEV
GKDVSLDSLLEQYDAVFVGVGTYRSMKAGLPNEDAPGVYDALPFLIANTKQVMGLEELPEEPFINTAGLNVVVLGGGDTA
MDCVRTALRHGASNVTCAYRRDEANMPGSKKEVKNAREEGANFEFNVQPVALELNEQGHVCGIRFLRTRLGEPDAQGRRR
PVPVEGSEFVMPADAVIMAFGFNPHGMPWLESHGVTVDKWGRIIADVESQYRYQTTNPKIFAGGDAVRGADLVVTAMAEG
RHAAQGIIDWLGVKSVKSH

Sequences:

>Translated_659_residues
MNRFIMANSQQCLGCHACEIACVMAHNDEQHVLSQHHFHPRITVIKHQQQRSAVTCHHCEDAPCARSCPNGAISHVDDSI
QVNQQKCIGCKSCVVACPFGTMQIVLTPVAAGKVKATAHKCDLCAGRENGPACVENCPADALQLVTDAALSGMAKSRRLR
TARQEHQPWHASTAAQEMPVMSKVEQMQATPARGEPDKLAIEARKTGFDEIYLPFRADQAQREASRCLKCGEHSVCEWTC
PLHNHIPQWIELVKAGNIDAAVELSHLTNTLPEITGRVCPQDRLCEGACTIRDEHGAVTIGNIERYISDQALAKGWRPDL
SHVTKVDKRVAIIGAGPAGLACADVLIRNGVAVTVYDRHPEIGGLLTFGIPSFKLDKSLLARRREIFSAMGIHFELNCEV
GKDVSLDSLLEQYDAVFVGVGTYRSMKAGLPNEDAPGVYDALPFLIANTKQVMGLEELPEEPFINTAGLNVVVLGGGDTA
MDCVRTALRHGASNVTCAYRRDEANMPGSKKEVKNAREEGANFEFNVQPVALELNEQGHVCGIRFLRTRLGEPDAQGRRR
PVPVEGSEFVMPADAVIMAFGFNPHGMPWLESHGVTVDKWGRIIADVESQYRYQTTNPKIFAGGDAVRGADLVVTAMAEG
RHAAQGIIDWLGVKSVKSH
>Mature_659_residues
MNRFIMANSQQCLGCHACEIACVMAHNDEQHVLSQHHFHPRITVIKHQQQRSAVTCHHCEDAPCARSCPNGAISHVDDSI
QVNQQKCIGCKSCVVACPFGTMQIVLTPVAAGKVKATAHKCDLCAGRENGPACVENCPADALQLVTDAALSGMAKSRRLR
TARQEHQPWHASTAAQEMPVMSKVEQMQATPARGEPDKLAIEARKTGFDEIYLPFRADQAQREASRCLKCGEHSVCEWTC
PLHNHIPQWIELVKAGNIDAAVELSHLTNTLPEITGRVCPQDRLCEGACTIRDEHGAVTIGNIERYISDQALAKGWRPDL
SHVTKVDKRVAIIGAGPAGLACADVLIRNGVAVTVYDRHPEIGGLLTFGIPSFKLDKSLLARRREIFSAMGIHFELNCEV
GKDVSLDSLLEQYDAVFVGVGTYRSMKAGLPNEDAPGVYDALPFLIANTKQVMGLEELPEEPFINTAGLNVVVLGGGDTA
MDCVRTALRHGASNVTCAYRRDEANMPGSKKEVKNAREEGANFEFNVQPVALELNEQGHVCGIRFLRTRLGEPDAQGRRR
PVPVEGSEFVMPADAVIMAFGFNPHGMPWLESHGVTVDKWGRIIADVESQYRYQTTNPKIFAGGDAVRGADLVVTAMAEG
RHAAQGIIDWLGVKSVKSH

Specific function: Unknown

COG id: COG0493

COG function: function code ER; NADPH-dependent glutamate synthase beta chain and related oxidoreductases

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 4 4Fe-4S ferredoxin-type domains [H]

Homologues:

Organism=Homo sapiens, GI119943098, Length=493, Percent_Identity=29.2089249492901, Blast_Score=162, Evalue=7e-40,
Organism=Escherichia coli, GI1788811, Length=659, Percent_Identity=99.3930197268589, Blast_Score=1361, Evalue=0.0,
Organism=Escherichia coli, GI87082180, Length=656, Percent_Identity=54.4207317073171, Blast_Score=729, Evalue=0.0,
Organism=Escherichia coli, GI1789606, Length=461, Percent_Identity=66.3774403470716, Blast_Score=647, Evalue=0.0,
Organism=Escherichia coli, GI1788468, Length=449, Percent_Identity=31.8485523385301, Blast_Score=191, Evalue=1e-49,
Organism=Escherichia coli, GI1789067, Length=172, Percent_Identity=48.8372093023256, Blast_Score=158, Evalue=1e-39,
Organism=Escherichia coli, GI1789243, Length=433, Percent_Identity=33.256351039261, Blast_Score=153, Evalue=3e-38,
Organism=Escherichia coli, GI2367245, Length=147, Percent_Identity=52.3809523809524, Blast_Score=145, Evalue=1e-35,
Organism=Escherichia coli, GI87082179, Length=166, Percent_Identity=44.578313253012, Blast_Score=141, Evalue=1e-34,
Organism=Escherichia coli, GI1789079, Length=185, Percent_Identity=38.3783783783784, Blast_Score=129, Evalue=5e-31,
Organism=Escherichia coli, GI87082114, Length=188, Percent_Identity=37.7659574468085, Blast_Score=115, Evalue=1e-26,
Organism=Escherichia coli, GI1787122, Length=158, Percent_Identity=31.6455696202532, Blast_Score=73, Evalue=6e-14,
Organism=Escherichia coli, GI2367345, Length=161, Percent_Identity=33.5403726708075, Blast_Score=69, Evalue=8e-13,
Organism=Escherichia coli, GI1787872, Length=153, Percent_Identity=30.0653594771242, Blast_Score=69, Evalue=8e-13,
Organism=Escherichia coli, GI1787749, Length=185, Percent_Identity=25.9459459459459, Blast_Score=67, Evalue=4e-12,
Organism=Escherichia coli, GI1790326, Length=168, Percent_Identity=24.4047619047619, Blast_Score=65, Evalue=2e-11,
Organism=Escherichia coli, GI226510944, Length=148, Percent_Identity=33.7837837837838, Blast_Score=64, Evalue=3e-11,
Organism=Caenorhabditis elegans, GI17570289, Length=480, Percent_Identity=33.3333333333333, Blast_Score=207, Evalue=1e-53,
Organism=Caenorhabditis elegans, GI71984108, Length=446, Percent_Identity=32.5112107623318, Blast_Score=160, Evalue=1e-39,
Organism=Caenorhabditis elegans, GI17543860, Length=161, Percent_Identity=30.4347826086957, Blast_Score=80, Evalue=4e-15,
Organism=Saccharomyces cerevisiae, GI6320030, Length=469, Percent_Identity=33.0490405117271, Blast_Score=219, Evalue=1e-57,
Organism=Drosophila melanogaster, GI28574881, Length=471, Percent_Identity=36.0934182590234, Blast_Score=258, Evalue=1e-68,
Organism=Drosophila melanogaster, GI24665539, Length=471, Percent_Identity=36.0934182590234, Blast_Score=258, Evalue=1e-68,
Organism=Drosophila melanogaster, GI24665547, Length=471, Percent_Identity=36.0934182590234, Blast_Score=257, Evalue=2e-68,
Organism=Drosophila melanogaster, GI24665543, Length=471, Percent_Identity=36.0934182590234, Blast_Score=257, Evalue=2e-68,
Organism=Drosophila melanogaster, GI24640763, Length=440, Percent_Identity=28.8636363636364, Blast_Score=149, Evalue=6e-36,
Organism=Drosophila melanogaster, GI18858217, Length=440, Percent_Identity=28.8636363636364, Blast_Score=149, Evalue=6e-36,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR001450
- InterPro:   IPR017896
- InterPro:   IPR017900
- InterPro:   IPR013027
- InterPro:   IPR012285
- InterPro:   IPR006006 [H]

Pfam domain/function: PF00037 Fer4; PF07992 Pyr_redox_2 [H]

EC number: NA

Molecular weight: Translated: 71828; Mature: 71828

Theoretical pI: Translated: 6.77; Mature: 6.77

Prosite motif: PS00028 ZINC_FINGER_C2H2_1 ; PS00198 4FE4S_FERREDOXIN

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

4.2 %Cys     (Translated Protein)
2.6 %Met     (Translated Protein)
6.8 %Cys+Met (Translated Protein)
4.2 %Cys     (Mature Protein)
2.6 %Met     (Mature Protein)
6.8 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MNRFIMANSQQCLGCHACEIACVMAHNDEQHVLSQHHFHPRITVIKHQQQRSAVTCHHCE
CCCEEECCCCCCCCCCCEEEEEEEECCCHHHHHHHCCCCCEEEEEEEHHHCCCEEEECCC
DAPCARSCPNGAISHVDDSIQVNQQKCIGCKSCVVACPFGTMQIVLTPVAAGKVKATAHK
CCCCHHCCCCCCHHHCCCCCEECHHHHCCCCHHEEECCCCCEEEEEEECCCCCEEECHHH
CDLCAGRENGPACVENCPADALQLVTDAALSGMAKSRRLRTARQEHQPWHASTAAQEMPV
HHHCCCCCCCCHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHCHH
MSKVEQMQATPARGEPDKLAIEARKTGFDEIYLPFRADQAQREASRCLKCGEHSVCEWTC
HHHHHHHHCCCCCCCCCCEEEEECCCCCCEEEEEECCCHHHHHHHHHHHCCCCCCEEEEC
PLHNHIPQWIELVKAGNIDAAVELSHLTNTLPEITGRVCPQDRLCEGACTIRDEHGAVTI
CHHHCCHHHHHHHHCCCCCCEEEHHHHHHHHHHHHCCCCCHHHHCCCCCEEEECCCEEEE
GNIERYISDQALAKGWRPDLSHVTKVDKRVAIIGAGPAGLACADVLIRNGVAVTVYDRHP
CCHHHHHHHHHHHCCCCCCHHHHHHHCCEEEEEECCCCHHHHHHHHHHCCCEEEEEECCC
EIGGLLTFGIPSFKLDKSLLARRREIFSAMGIHFELNCEVGKDVSLDSLLEQYDAVFVGV
CCCCEEEECCCCHHHHHHHHHHHHHHHHHHCCEEEEECCCCCCCCHHHHHHHHCEEEEEC
GTYRSMKAGLPNEDAPGVYDALPFLIANTKQVMGLEELPEEPFINTAGLNVVVLGGGDTA
CCHHHHHCCCCCCCCCCHHHHHHHHHCCCHHHCCHHHCCCCCCEECCCCEEEEECCCCHH
MDCVRTALRHGASNVTCAYRRDEANMPGSKKEVKNAREEGANFEFNVQPVALELNEQGHV
HHHHHHHHHCCCCCEEEEEECCCCCCCCCHHHHHHHHHCCCCEEEEEEEEEEEECCCCCC
CGIRFLRTRLGEPDAQGRRRPVPVEGSEFVMPADAVIMAFGFNPHGMPWLESHGVTVDKW
HHHHHHHHHCCCCCCCCCCCCCCCCCCCEEECCCEEEEEECCCCCCCCCHHCCCCCHHHH
GRIIADVESQYRYQTTNPKIFAGGDAVRGADLVVTAMAEGRHAAQGIIDWLGVKSVKSH
HHHHHHHHHHCEEECCCCEEEECCCCCCCCCEEEEEECCCCHHHHHHHHHHCCHHHCCC
>Mature Secondary Structure
MNRFIMANSQQCLGCHACEIACVMAHNDEQHVLSQHHFHPRITVIKHQQQRSAVTCHHCE
CCCEEECCCCCCCCCCCEEEEEEEECCCHHHHHHHCCCCCEEEEEEEHHHCCCEEEECCC
DAPCARSCPNGAISHVDDSIQVNQQKCIGCKSCVVACPFGTMQIVLTPVAAGKVKATAHK
CCCCHHCCCCCCHHHCCCCCEECHHHHCCCCHHEEECCCCCEEEEEEECCCCCEEECHHH
CDLCAGRENGPACVENCPADALQLVTDAALSGMAKSRRLRTARQEHQPWHASTAAQEMPV
HHHCCCCCCCCHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHCHH
MSKVEQMQATPARGEPDKLAIEARKTGFDEIYLPFRADQAQREASRCLKCGEHSVCEWTC
HHHHHHHHCCCCCCCCCCEEEEECCCCCCEEEEEECCCHHHHHHHHHHHCCCCCCEEEEC
PLHNHIPQWIELVKAGNIDAAVELSHLTNTLPEITGRVCPQDRLCEGACTIRDEHGAVTI
CHHHCCHHHHHHHHCCCCCCEEEHHHHHHHHHHHHCCCCCHHHHCCCCCEEEECCCEEEE
GNIERYISDQALAKGWRPDLSHVTKVDKRVAIIGAGPAGLACADVLIRNGVAVTVYDRHP
CCHHHHHHHHHHHCCCCCCHHHHHHHCCEEEEEECCCCHHHHHHHHHHCCCEEEEEECCC
EIGGLLTFGIPSFKLDKSLLARRREIFSAMGIHFELNCEVGKDVSLDSLLEQYDAVFVGV
CCCCEEEECCCCHHHHHHHHHHHHHHHHHHCCEEEEECCCCCCCCHHHHHHHHCEEEEEC
GTYRSMKAGLPNEDAPGVYDALPFLIANTKQVMGLEELPEEPFINTAGLNVVVLGGGDTA
CCHHHHHCCCCCCCCCCHHHHHHHHHCCCHHHCCHHHCCCCCCEECCCCEEEEECCCCHH
MDCVRTALRHGASNVTCAYRRDEANMPGSKKEVKNAREEGANFEFNVQPVALELNEQGHV
HHHHHHHHHCCCCCEEEEEECCCCCCCCCHHHHHHHHHCCCCEEEEEEEEEEEECCCCCC
CGIRFLRTRLGEPDAQGRRRPVPVEGSEFVMPADAVIMAFGFNPHGMPWLESHGVTVDKW
HHHHHHHHHCCCCCCCCCCCCCCCCCCCEEECCCEEEEEECCCCCCCCCHHCCCCCHHHH
GRIIADVESQYRYQTTNPKIFAGGDAVRGADLVVTAMAEGRHAAQGIIDWLGVKSVKSH
HHHHHHHHHHCEEECCCCEEEECCCCCCCCCEEEEEECCCCHHHHHHHHHHCCHHHCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 8955321; 9205837; 9278503 [H]