Definition Escherichia coli O157:H7 str. EC4115, complete genome.
Accession NC_011353
Length 5,572,075

Click here to switch to the map view.

The map label for this gene is adiA [H]

Identifier: 209400739

GI number: 209400739

Start: 5267903

End: 5270173

Strand: Reverse

Name: adiA [H]

Synonym: ECH74115_5631

Alternate gene names: 209400739

Gene position: 5270173-5267903 (Counterclockwise)

Preceding gene: 209400157

Following gene: 209395989

Centisome position: 94.58

GC content: 52.8

Gene sequence:

>2271_bases
ATGATGAAAGTATTAATTGTTGAAAGCGAGTTTCTCCATCAAGACACCTGGGTCGGTAACGCTGTTGAGCGTCTGGCAGA
TGCTTTAAGCCAGCAAAATGTTACCGTGATTAAATCCACCTCCTTTGATGATGGTTTTGCCATTCTCTCTTCAAACGAAG
CCATTGACTGCCTGATGTTCAGCTATCAAATGGAACATCCGGACGAACATCAAAACGTCAGACAATTGATCGGTAAGCTT
CATGAGCGCCAACAAAACGTGCCGGTCTTCCTGTTGGGCGATCGGGAAAAAGCCCTCGCCGCAATGGACCGGGATCTGCT
GGAGCTTGTCGATGAATTCGCCTGGATTCTGGAAGATACCGCCGACTTTATCGCCGGACGCGCCGTTGCCGCGATGACCC
GCTACCGCCAGCAGCTGTTGCCGCCACTGTTCAGCGCGCTGATGAAATATAGCGACATCCATGAATATTCCTGGGCAGCG
CCAGGCCACCAGGGCGGCGTTGGTTTTACCAAAACACCCGCCGGACGTTTCTACCATGACTACTACGGTGAAAATCTGTT
CCGCACCGACATGGGCATCGAACGAACTTCCCTCGGTTCTTTGCTTGACCATACTGGCGCATTTGGCGAAAGCGAAAAAT
ATGCCGCACGCGTATTTGGTGCCGATCGCTCCTGGTCGGTAGTCGTCGGTACTTCCGGCTCTAACCGCACCATCATGCAG
GCTTGCATGACCGATAACGATGTCGTGGTCGTTGACCGTAACTGCCATAAATCCATCGAACAAGGTTTGATGCTGACAGG
CGCGAAACCGGTCTACATGGTGCCAAGCCGCAACCGCTACGGCATTATCGGGCCAATCTATCCGCAGGAAATGCAACCTG
AAACCTTGCAGAAGAAAATCAGTGAAAGCCCGCTGACTAAAGACAAAGCCGGGCAAAAACCGTCTTACTGCGTGGTGACC
AACTGCACCTATGACGGCGTGTGTTATAACGCTAAAGAAGCGCAGGATCTGCTGGAAAAAACCTCCGATCGTCTGCACTT
TGACGAAGCCTGGTACGGCTATGCACGTTTCAACCCGATCTATGCCGATCACTATGCCATGCGCGGCGAACCTGGCGATC
ACAACGGTCCTACCGTTTTCGCCACCCACTCCACCCACAAACTGCTGAATGCGCTTTCACAGGCCTCTTATATTCATGTA
CGTGAAGGTCGTGGGGCGATTAACTTCTCCCGCTTCAACCAGGCCTACATGATGCATGCCACCACCTCCCCGCTGTATGC
CATCTGCGCATCCAACGACGTGGCGGTGTCGATGATGGACGGCAACAGCGGCCTGTCACTGACGCAGGAAGTGATCGACG
AAGCGGTTGATTTCCGTCAGGCGATGGCGCGGCTGTATAAAGAGTTCGCCGCTGACGGTAGCTGGTTCTTCAAACCGTGG
AACAAAGAAGTCGTCACCGACCCACAAACCGGCAAAACCTATGACTTTGCTGACGCACCAACCAAACTGCTGACCACCGT
TCAGGACTGCTGGGTAATGCATCCGGGCGAAAGCTGGCACGGCTTCAAAGATATTCCGGATAACTGGAGTATGCTCGACC
CGATTAAAGTCAGCATCCTTGCTCCGGGAATGGGTGAAGATGGTGAACTGGAAGAAACCGGTGTTCCGGCGGCGCTGGTC
ACTGCCTGGCTTGGTCGCCACGGCATTGTGCCTACCCGCACCACTGACTTCCAAATTATGTTCCTGTTCTCTATGGGCGT
AACCCGTGGGAAATGGGGGACTCTGGTTAACACCCTTTGCTCCTTCAAACGCCACTATGACGCCAACACACCGCTGGCGC
AGGTGATGCCGGAACTTGTTGAACAATATCCTGACACTTACGCGAACATGGGGATTCACGATCTGGGTGACACCATGTTT
GCCTGGCTGAAAGAAAACAACCCTGGCGCACGGTTGAACGAAGCCTATTCCGGCCTGCCGGTGGCGGAAATCACCCCGCG
TGAAGCGTACAACGCGATTGTCGACAACAATGTCGAACTGGTATCCATTGAAAATCTGCCAGGACGTATCGCGGCAAACT
CAGTTATCCCGTATCCGCCAGGAATCCCGATGCTGCTGTCTGGTGAAAACTTCGGCGATAAAAACAGTCCGCAAGTAAGT
TATTTACGCTCGCTGCAATCCTGGGACCATCATTTCCCTGGATTTGAACACGAAACTGAAGGGACTGAAATTATTGACGG
TATTTACCACGTTATGTGTGTGAAAGCGTAA

Upstream 100 bases:

>100_bases
ACAAATATTTCAAAAATGTTTGTTTTTCACGCGCTTTACAGCCCGAAAAGGCCGGAAGATACTTGCCCGCAACGAAGATT
CCTTCATAACCGGGTAAGCA

Downstream 100 bases:

>100_bases
CCACTATTCCGCTGAAGGCGTAATTGTTTAAATAACATTACGCCGCCTGGCCTTAGGCCTTTTGAGTATGGCAACGTTTT
CATAAAAATTGCTGCAAACA

Product: biodegradative arginine decarboxylase

Products: NA

Alternate protein names: ADC [H]

Number of amino acids: Translated: 756; Mature: 756

Protein sequence:

>756_residues
MMKVLIVESEFLHQDTWVGNAVERLADALSQQNVTVIKSTSFDDGFAILSSNEAIDCLMFSYQMEHPDEHQNVRQLIGKL
HERQQNVPVFLLGDREKALAAMDRDLLELVDEFAWILEDTADFIAGRAVAAMTRYRQQLLPPLFSALMKYSDIHEYSWAA
PGHQGGVGFTKTPAGRFYHDYYGENLFRTDMGIERTSLGSLLDHTGAFGESEKYAARVFGADRSWSVVVGTSGSNRTIMQ
ACMTDNDVVVVDRNCHKSIEQGLMLTGAKPVYMVPSRNRYGIIGPIYPQEMQPETLQKKISESPLTKDKAGQKPSYCVVT
NCTYDGVCYNAKEAQDLLEKTSDRLHFDEAWYGYARFNPIYADHYAMRGEPGDHNGPTVFATHSTHKLLNALSQASYIHV
REGRGAINFSRFNQAYMMHATTSPLYAICASNDVAVSMMDGNSGLSLTQEVIDEAVDFRQAMARLYKEFAADGSWFFKPW
NKEVVTDPQTGKTYDFADAPTKLLTTVQDCWVMHPGESWHGFKDIPDNWSMLDPIKVSILAPGMGEDGELEETGVPAALV
TAWLGRHGIVPTRTTDFQIMFLFSMGVTRGKWGTLVNTLCSFKRHYDANTPLAQVMPELVEQYPDTYANMGIHDLGDTMF
AWLKENNPGARLNEAYSGLPVAEITPREAYNAIVDNNVELVSIENLPGRIAANSVIPYPPGIPMLLSGENFGDKNSPQVS
YLRSLQSWDHHFPGFEHETEGTEIIDGIYHVMCVKA

Sequences:

>Translated_756_residues
MMKVLIVESEFLHQDTWVGNAVERLADALSQQNVTVIKSTSFDDGFAILSSNEAIDCLMFSYQMEHPDEHQNVRQLIGKL
HERQQNVPVFLLGDREKALAAMDRDLLELVDEFAWILEDTADFIAGRAVAAMTRYRQQLLPPLFSALMKYSDIHEYSWAA
PGHQGGVGFTKTPAGRFYHDYYGENLFRTDMGIERTSLGSLLDHTGAFGESEKYAARVFGADRSWSVVVGTSGSNRTIMQ
ACMTDNDVVVVDRNCHKSIEQGLMLTGAKPVYMVPSRNRYGIIGPIYPQEMQPETLQKKISESPLTKDKAGQKPSYCVVT
NCTYDGVCYNAKEAQDLLEKTSDRLHFDEAWYGYARFNPIYADHYAMRGEPGDHNGPTVFATHSTHKLLNALSQASYIHV
REGRGAINFSRFNQAYMMHATTSPLYAICASNDVAVSMMDGNSGLSLTQEVIDEAVDFRQAMARLYKEFAADGSWFFKPW
NKEVVTDPQTGKTYDFADAPTKLLTTVQDCWVMHPGESWHGFKDIPDNWSMLDPIKVSILAPGMGEDGELEETGVPAALV
TAWLGRHGIVPTRTTDFQIMFLFSMGVTRGKWGTLVNTLCSFKRHYDANTPLAQVMPELVEQYPDTYANMGIHDLGDTMF
AWLKENNPGARLNEAYSGLPVAEITPREAYNAIVDNNVELVSIENLPGRIAANSVIPYPPGIPMLLSGENFGDKNSPQVS
YLRSLQSWDHHFPGFEHETEGTEIIDGIYHVMCVKA
>Mature_756_residues
MMKVLIVESEFLHQDTWVGNAVERLADALSQQNVTVIKSTSFDDGFAILSSNEAIDCLMFSYQMEHPDEHQNVRQLIGKL
HERQQNVPVFLLGDREKALAAMDRDLLELVDEFAWILEDTADFIAGRAVAAMTRYRQQLLPPLFSALMKYSDIHEYSWAA
PGHQGGVGFTKTPAGRFYHDYYGENLFRTDMGIERTSLGSLLDHTGAFGESEKYAARVFGADRSWSVVVGTSGSNRTIMQ
ACMTDNDVVVVDRNCHKSIEQGLMLTGAKPVYMVPSRNRYGIIGPIYPQEMQPETLQKKISESPLTKDKAGQKPSYCVVT
NCTYDGVCYNAKEAQDLLEKTSDRLHFDEAWYGYARFNPIYADHYAMRGEPGDHNGPTVFATHSTHKLLNALSQASYIHV
REGRGAINFSRFNQAYMMHATTSPLYAICASNDVAVSMMDGNSGLSLTQEVIDEAVDFRQAMARLYKEFAADGSWFFKPW
NKEVVTDPQTGKTYDFADAPTKLLTTVQDCWVMHPGESWHGFKDIPDNWSMLDPIKVSILAPGMGEDGELEETGVPAALV
TAWLGRHGIVPTRTTDFQIMFLFSMGVTRGKWGTLVNTLCSFKRHYDANTPLAQVMPELVEQYPDTYANMGIHDLGDTMF
AWLKENNPGARLNEAYSGLPVAEITPREAYNAIVDNNVELVSIENLPGRIAANSVIPYPPGIPMLLSGENFGDKNSPQVS
YLRSLQSWDHHFPGFEHETEGTEIIDGIYHVMCVKA

Specific function: ADC can be found in two forms:biodegradative and biosynthetic. The biodegradative form may play a role in regulating pH by consuming proteins [H]

COG id: COG1982

COG function: function code E; Arginine/lysine/ornithine decarboxylases

Gene ontology:

Cell location: Cytoplasm [H]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the Orn/Lys/Arg decarboxylase class-I family [H]

Homologues:

Organism=Escherichia coli, GI221142684, Length=755, Percent_Identity=99.7350993377484, Blast_Score=1586, Evalue=0.0,
Organism=Escherichia coli, GI1790573, Length=740, Percent_Identity=35.9459459459459, Blast_Score=478, Evalue=1e-136,
Organism=Escherichia coli, GI1786384, Length=735, Percent_Identity=34.9659863945578, Blast_Score=457, Evalue=1e-130,
Organism=Escherichia coli, GI87082193, Length=636, Percent_Identity=33.4905660377358, Blast_Score=360, Evalue=1e-100,
Organism=Escherichia coli, GI1786909, Length=678, Percent_Identity=31.5634218289086, Blast_Score=339, Evalue=5e-94,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR005308
- InterPro:   IPR011193
- InterPro:   IPR000310
- InterPro:   IPR008286
- InterPro:   IPR015424
- InterPro:   IPR015421
- InterPro:   IPR015422 [H]

Pfam domain/function: PF01276 OKR_DC_1; PF03711 OKR_DC_1_C; PF03709 OKR_DC_1_N [H]

EC number: =4.1.1.19 [H]

Molecular weight: Translated: 84541; Mature: 84541

Theoretical pI: Translated: 4.96; Mature: 4.96

Prosite motif: PS00703 OKR_DC_1

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.3 %Cys     (Translated Protein)
3.8 %Met     (Translated Protein)
5.2 %Cys+Met (Translated Protein)
1.3 %Cys     (Mature Protein)
3.8 %Met     (Mature Protein)
5.2 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MMKVLIVESEFLHQDTWVGNAVERLADALSQQNVTVIKSTSFDDGFAILSSNEAIDCLMF
CEEEEEECHHHHHHHHHHHHHHHHHHHHHCCCCEEEEEECCCCCCEEEEECCCCEEEEEE
SYQMEHPDEHQNVRQLIGKLHERQQNVPVFLLGDREKALAAMDRDLLELVDEFAWILEDT
EEECCCCCHHHHHHHHHHHHHHHHCCCCEEEECCCHHHHHHHHHHHHHHHHHHHHHHHHH
ADFIAGRAVAAMTRYRQQLLPPLFSALMKYSDIHEYSWAAPGHQGGVGFTKTPAGRFYHD
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCHHHH
YYGENLFRTDMGIERTSLGSLLDHTGAFGESEKYAARVFGADRSWSVVVGTSGSNRTIMQ
HHCCCEEECCCCCCHHHHHHHHHHCCCCCCCCHHHHHEECCCCCCEEEEECCCCCHHHHH
ACMTDNDVVVVDRNCHKSIEQGLMLTGAKPVYMVPSRNRYGIIGPIYPQEMQPETLQKKI
HHCCCCCEEEECCCHHHHHHCCEEEECCCCEEECCCCCCCEEECCCCCCCCCHHHHHHHH
SESPLTKDKAGQKPSYCVVTNCTYDGVCYNAKEAQDLLEKTSDRLHFDEAWYGYARFNPI
HCCCCCCCCCCCCCCEEEEECCCCCCEEECHHHHHHHHHHHHCCCEECHHHCCCEECCCE
YADHYAMRGEPGDHNGPTVFATHSTHKLLNALSQASYIHVREGRGAINFSRFNQAYMMHA
EECCCEECCCCCCCCCCEEEEECHHHHHHHHHHHCCEEEEECCCCCEEHHHCCCEEEEEE
TTSPLYAICASNDVAVSMMDGNSGLSLTQEVIDEAVDFRQAMARLYKEFAADGSWFFKPW
CCCCEEEEECCCCEEEEEECCCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCCEEECCC
NKEVVTDPQTGKTYDFADAPTKLLTTVQDCWVMHPGESWHGFKDIPDNWSMLDPIKVSIL
CCCEECCCCCCCEECCCCCCHHHHHHHHHHEEECCCCCCCCCCCCCCCCCCCCCEEEEEE
APGMGEDGELEETGVPAALVTAWLGRHGIVPTRTTDFQIMFLFSMGVTRGKWGTLVNTLC
CCCCCCCCCCHHCCCCHHHHHHHHHCCCCCCCCCCCEEEEEEEECCCCCCHHHHHHHHHH
SFKRHYDANTPLAQVMPELVEQYPDTYANMGIHDLGDTMFAWLKENNPGARLNEAYSGLP
HHHHHCCCCCCHHHHHHHHHHHCCHHHHCCCHHHHHHHHHHHHCCCCCCCCHHHHHCCCC
VAEITPREAYNAIVDNNVELVSIENLPGRIAANSVIPYPPGIPMLLSGENFGDKNSPQVS
CCCCCCHHHHHHHHCCCEEEEEECCCCCCEECCCCCCCCCCCCEEECCCCCCCCCCCHHH
YLRSLQSWDHHFPGFEHETEGTEIIDGIYHVMCVKA
HHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHEECC
>Mature Secondary Structure
MMKVLIVESEFLHQDTWVGNAVERLADALSQQNVTVIKSTSFDDGFAILSSNEAIDCLMF
CEEEEEECHHHHHHHHHHHHHHHHHHHHHCCCCEEEEEECCCCCCEEEEECCCCEEEEEE
SYQMEHPDEHQNVRQLIGKLHERQQNVPVFLLGDREKALAAMDRDLLELVDEFAWILEDT
EEECCCCCHHHHHHHHHHHHHHHHCCCCEEEECCCHHHHHHHHHHHHHHHHHHHHHHHHH
ADFIAGRAVAAMTRYRQQLLPPLFSALMKYSDIHEYSWAAPGHQGGVGFTKTPAGRFYHD
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCHHHH
YYGENLFRTDMGIERTSLGSLLDHTGAFGESEKYAARVFGADRSWSVVVGTSGSNRTIMQ
HHCCCEEECCCCCCHHHHHHHHHHCCCCCCCCHHHHHEECCCCCCEEEEECCCCCHHHHH
ACMTDNDVVVVDRNCHKSIEQGLMLTGAKPVYMVPSRNRYGIIGPIYPQEMQPETLQKKI
HHCCCCCEEEECCCHHHHHHCCEEEECCCCEEECCCCCCCEEECCCCCCCCCHHHHHHHH
SESPLTKDKAGQKPSYCVVTNCTYDGVCYNAKEAQDLLEKTSDRLHFDEAWYGYARFNPI
HCCCCCCCCCCCCCCEEEEECCCCCCEEECHHHHHHHHHHHHCCCEECHHHCCCEECCCE
YADHYAMRGEPGDHNGPTVFATHSTHKLLNALSQASYIHVREGRGAINFSRFNQAYMMHA
EECCCEECCCCCCCCCCEEEEECHHHHHHHHHHHCCEEEEECCCCCEEHHHCCCEEEEEE
TTSPLYAICASNDVAVSMMDGNSGLSLTQEVIDEAVDFRQAMARLYKEFAADGSWFFKPW
CCCCEEEEECCCCEEEEEECCCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCCEEECCC
NKEVVTDPQTGKTYDFADAPTKLLTTVQDCWVMHPGESWHGFKDIPDNWSMLDPIKVSIL
CCCEECCCCCCCEECCCCCCHHHHHHHHHHEEECCCCCCCCCCCCCCCCCCCCCEEEEEE
APGMGEDGELEETGVPAALVTAWLGRHGIVPTRTTDFQIMFLFSMGVTRGKWGTLVNTLC
CCCCCCCCCCHHCCCCHHHHHHHHHCCCCCCCCCCCEEEEEEEECCCCCCHHHHHHHHHH
SFKRHYDANTPLAQVMPELVEQYPDTYANMGIHDLGDTMFAWLKENNPGARLNEAYSGLP
HHHHHCCCCCCHHHHHHHHHHHCCHHHHCCCHHHHHHHHHHHHCCCCCCCCHHHHHCCCC
VAEITPREAYNAIVDNNVELVSIENLPGRIAANSVIPYPPGIPMLLSGENFGDKNSPQVS
CCCCCCHHHHHHHHCCCEEEEEECCCCCCEECCCCCCCCCCCCEEECCCCCCCCCCCHHH
YLRSLQSWDHHFPGFEHETEGTEIIDGIYHVMCVKA
HHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHEECC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 8383109; 7610040; 9278503; 2830169; 4204273 [H]