Definition Escherichia coli HS, complete genome.
Accession NC_009800
Length 4,643,538

Click here to switch to the map view.

The map label for this gene is aer

Identifier: 157162547

GI number: 157162547

Start: 3261000

End: 3262520

Strand: Reverse

Name: aer

Synonym: EcHS_A3253

Alternate gene names: 157162547

Gene position: 3262520-3261000 (Counterclockwise)

Preceding gene: 157162548

Following gene: 157162545

Centisome position: 70.26

GC content: 54.77

Gene sequence:

>1521_bases
ATGTCTTCTCATCCGTATGTCACCCAGCAAAATACCCCGCTGGCGGACGATACCACTCTGATGTCCACTACCGATCTGCA
AAGCTATATCACTCATGCTAATGACACTTTTGTGCAGGTGAGCGGCTATACCTTGCAAGAGTTACAAGGGCAGCCGCACA
ACATGGTGCGTCACCCGGATATGCCAAAAGCGGCGTTTGCGGATATGTGGTTCACCCTGAAAAAAGGGGAGCCCTGGAGC
GGCATCGTGAAAAATCGCCGCAAAAATGGTGACCATTATTGGGTGCGGGCCAATGCGGTACCGATGGTGCGCGAGGGAAA
AATCAGTGGCTATATGTCGATTCGTACCCGGGCGACGGATGAAGAGATCGCGGCGGTGGAGCCGCTGTACAAAGCGTTGA
ACGCCGGACGTACCAGTAAGCGTATTCATAAAGGCCTGGTGGTGCGTAAAGGCTGGCTGGGTAAACTGCCTTCATTACCG
CTTCGCTGGCGGGCGCGTGGAGTGATGACCCTGATGTTTATCTTGCTGGCGGCCATGCTTTGGTTTGTTGCTGCCCCGGT
GGTGACGTATATCCTCTGTGCGTTAGTGGTATTGTTGGCAAGCGCCTGTTTTGAATGGCAGATTGTGCGCCCGATAGAAA
ATGTTGCCCATCAGGCACTGAAGGTGGCGACCGGAGAACGTAATAGTGTTGAGCATCTGAATCGCAGCGATGAGCTGGGG
CTGACATTACGTGCGGTAGGGCAACTTGGCCTGATGTGCCGTTGGCTAATTAACGATGTCTCAAGCCAGGTGTCCAGTGT
CAGAAATGGCAGTGAGACGCTGGCGAAAGGCACCGATGAACTGAACGAACATACCCAGCAGACAGTTGATAACGTTCAGC
AAACGGTGGCGACCATGAACCAAATGGCGGCGTCGGTGAAACAGAACTCTGCCACGGCGTCGGCTGCCGATAAACTGTCA
ATCACTGCCAGTAATGCGGCAGTGCAGGGTGGGGAGGCGATGACCACGGTGATCAAGACAATGGACGATATCGCCGACAG
TACCCAGCGCATTGGCACCATTACTTCGCTGATTAACGATATTGCGTTTCAGACCAATATTCTGGCCCTGAATGCGGCGG
TGGAAGCGGCGCGTGCCGGCGAACAGGGCAAAGGTTTTGCAGTGGTGGCAGGGGAAGTGCGTCATTTAGCCAGCCGCAGC
GCTAATGCTGCCAACGATATTCGCAAGCTGATTGATGCCAGTGCTGATAAGGTGCAATCCGGTTCGCAGCAGGTACACGC
CGCCGGACGGACGATGGAAGATATTGTGGCACAGGTGAAAAACGTCACCCAGTTGATCGCCCAGATTAGCCATTCAACGC
TGGAACAGGCCGATGGGCTTTCCAGCCTGACCCGTGCAGTGGATGAGCTTAACCTGATCACCCAGAAAAATGCCGAGCTG
GTGGAAGAGAGTGCGCAGGTGTCGGCGATGGTGAAACACCGCGCCAGCCGACTGGAAGACGCGGTGACGGTACTGCATTA
A

Upstream 100 bases:

>100_bases
GCGATCTAAATCAAATTAATCGGTTAAAGATAACCGCAGCGGGGCCGACATAAACTCTGACAAGAAGTTAACAACCATAT
AACCTGCACAGGACGCGAAC

Downstream 100 bases:

>100_bases
TCGGTATGCCGGATCCGGCGGTTGGAGCACAATGCCTGATGCGATGCTGGCGCATCTTATCAGGCCTGCGGGGTGTGTAG
CGGGTGTAGGCCGGATAAGG

Product: aerotaxis receptor

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 506; Mature: 505

Protein sequence:

>506_residues
MSSHPYVTQQNTPLADDTTLMSTTDLQSYITHANDTFVQVSGYTLQELQGQPHNMVRHPDMPKAAFADMWFTLKKGEPWS
GIVKNRRKNGDHYWVRANAVPMVREGKISGYMSIRTRATDEEIAAVEPLYKALNAGRTSKRIHKGLVVRKGWLGKLPSLP
LRWRARGVMTLMFILLAAMLWFVAAPVVTYILCALVVLLASACFEWQIVRPIENVAHQALKVATGERNSVEHLNRSDELG
LTLRAVGQLGLMCRWLINDVSSQVSSVRNGSETLAKGTDELNEHTQQTVDNVQQTVATMNQMAASVKQNSATASAADKLS
ITASNAAVQGGEAMTTVIKTMDDIADSTQRIGTITSLINDIAFQTNILALNAAVEAARAGEQGKGFAVVAGEVRHLASRS
ANAANDIRKLIDASADKVQSGSQQVHAAGRTMEDIVAQVKNVTQLIAQISHSTLEQADGLSSLTRAVDELNLITQKNAEL
VEESAQVSAMVKHRASRLEDAVTVLH

Sequences:

>Translated_506_residues
MSSHPYVTQQNTPLADDTTLMSTTDLQSYITHANDTFVQVSGYTLQELQGQPHNMVRHPDMPKAAFADMWFTLKKGEPWS
GIVKNRRKNGDHYWVRANAVPMVREGKISGYMSIRTRATDEEIAAVEPLYKALNAGRTSKRIHKGLVVRKGWLGKLPSLP
LRWRARGVMTLMFILLAAMLWFVAAPVVTYILCALVVLLASACFEWQIVRPIENVAHQALKVATGERNSVEHLNRSDELG
LTLRAVGQLGLMCRWLINDVSSQVSSVRNGSETLAKGTDELNEHTQQTVDNVQQTVATMNQMAASVKQNSATASAADKLS
ITASNAAVQGGEAMTTVIKTMDDIADSTQRIGTITSLINDIAFQTNILALNAAVEAARAGEQGKGFAVVAGEVRHLASRS
ANAANDIRKLIDASADKVQSGSQQVHAAGRTMEDIVAQVKNVTQLIAQISHSTLEQADGLSSLTRAVDELNLITQKNAEL
VEESAQVSAMVKHRASRLEDAVTVLH
>Mature_505_residues
SSHPYVTQQNTPLADDTTLMSTTDLQSYITHANDTFVQVSGYTLQELQGQPHNMVRHPDMPKAAFADMWFTLKKGEPWSG
IVKNRRKNGDHYWVRANAVPMVREGKISGYMSIRTRATDEEIAAVEPLYKALNAGRTSKRIHKGLVVRKGWLGKLPSLPL
RWRARGVMTLMFILLAAMLWFVAAPVVTYILCALVVLLASACFEWQIVRPIENVAHQALKVATGERNSVEHLNRSDELGL
TLRAVGQLGLMCRWLINDVSSQVSSVRNGSETLAKGTDELNEHTQQTVDNVQQTVATMNQMAASVKQNSATASAADKLSI
TASNAAVQGGEAMTTVIKTMDDIADSTQRIGTITSLINDIAFQTNILALNAAVEAARAGEQGKGFAVVAGEVRHLASRSA
NAANDIRKLIDASADKVQSGSQQVHAAGRTMEDIVAQVKNVTQLIAQISHSTLEQADGLSSLTRAVDELNLITQKNAELV
EESAQVSAMVKHRASRLEDAVTVLH

Specific function: Signal transducer for aerotaxis. The aerotactic response is the accumulation of cells around air bubbles. The nature of the sensory stimulus detected by this protein is the proton motive force or cellular redox state. It uses a FAD prosthetic group as a r

COG id: COG0840

COG function: function code NT; Methyl-accepting chemotaxis protein

Gene ontology:

Cell location: Cell inner membrane; Multi-pass membrane protein

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 PAS (PER-ARNT-SIM) domain

Homologues:

Organism=Escherichia coli, GI1789453, Length=506, Percent_Identity=100, Blast_Score=1042, Evalue=0.0,
Organism=Escherichia coli, GI1787690, Length=323, Percent_Identity=39.938080495356, Blast_Score=219, Evalue=3e-58,
Organism=Escherichia coli, GI2367378, Length=324, Percent_Identity=40.7407407407407, Blast_Score=202, Evalue=4e-53,
Organism=Escherichia coli, GI1788195, Length=268, Percent_Identity=45.8955223880597, Blast_Score=202, Evalue=4e-53,
Organism=Escherichia coli, GI1788194, Length=249, Percent_Identity=46.1847389558233, Blast_Score=199, Evalue=3e-52,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): AER_ECOLI (P50466)

Other databases:

- EMBL:   U28379
- EMBL:   U00096
- EMBL:   AP009048
- PIR:   E65095
- RefSeq:   AP_003621.1
- RefSeq:   NP_417543.1
- ProteinModelPortal:   P50466
- DIP:   DIP-9061N
- STRING:   P50466
- EnsemblBacteria:   EBESCT00000003822
- EnsemblBacteria:   EBESCT00000016232
- GeneID:   945301
- GenomeReviews:   AP009048_GR
- GenomeReviews:   U00096_GR
- KEGG:   ecj:JW3043
- KEGG:   eco:b3072
- EchoBASE:   EB2789
- EcoGene:   EG12955
- eggNOG:   COG0840
- GeneTree:   EBGT00050000009142
- HOGENOM:   HBG752668
- OMA:   SRFREST
- ProtClustDB:   CLSK880569
- BioCyc:   EcoCyc:G7595-MONOMER
- Genevestigator:   P50466
- GO:   GO:0006935
- InterPro:   IPR004090
- InterPro:   IPR004089
- InterPro:   IPR003660
- InterPro:   IPR001610
- InterPro:   IPR000014
- InterPro:   IPR013655
- PRINTS:   PR00260
- SMART:   SM00283
- SMART:   SM00086
- SMART:   SM00091
- TIGRFAMs:   TIGR00229

Pfam domain/function: PF00672 HAMP; PF00015 MCPsignal; PF08447 PAS_3

EC number: NA

Molecular weight: Translated: 55066; Mature: 54935

Theoretical pI: Translated: 8.15; Mature: 8.15

Prosite motif: PS50111 CHEMOTAXIS_TRANSDUC_2

Important sites: NA

Signals:

None

Transmembrane regions:

HASH(0x161c3814)-; HASH(0x1777b7b4)-;

Cys/Met content:

0.6 %Cys     (Translated Protein)
3.4 %Met     (Translated Protein)
4.0 %Cys+Met (Translated Protein)
0.6 %Cys     (Mature Protein)
3.2 %Met     (Mature Protein)
3.8 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSSHPYVTQQNTPLADDTTLMSTTDLQSYITHANDTFVQVSGYTLQELQGQPHNMVRHPD
CCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHCCCCCEEEECCCCHHHHCCCCCCCCCCCC
MPKAAFADMWFTLKKGEPWSGIVKNRRKNGDHYWVRANAVPMVREGKISGYMSIRTRATD
CCHHHHHHHHEEEECCCCCHHHHHHHCCCCCEEEEEECCCCCEECCCCCCEEEEEECCCC
EEIAAVEPLYKALNAGRTSKRIHKGLVVRKGWLGKLPSLPLRWRARGVMTLMFILLAAML
HHHHHHHHHHHHHHCCCHHHHHHHCHHEECCCCCCCCCCCHHHHHHHHHHHHHHHHHHHH
WFVAAPVVTYILCALVVLLASACFEWQIVRPIENVAHQALKVATGERNSVEHLNRSDELG
HHHHHHHHHHHHHHHHHHHHHHHHCHHHHHHHHHHHHHHHHHHCCCCCHHHHCCCCCCCC
LTLRAVGQLGLMCRWLINDVSSQVSSVRNGSETLAKGTDELNEHTQQTVDNVQQTVATMN
HHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHCCHHHHHHHHHHHHHHHHHHHHHHH
QMAASVKQNSATASAADKLSITASNAAVQGGEAMTTVIKTMDDIADSTQRIGTITSLIND
HHHHHHHHCCCHHHHHHCEEEEECCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
IAFQTNILALNAAVEAARAGEQGKGFAVVAGEVRHLASRSANAANDIRKLIDASADKVQS
HHHHHHHHHHHHHHHHHHCCCCCCCEEEEHHHHHHHHHCCCCHHHHHHHHHHCCHHHHHC
GSQQVHAAGRTMEDIVAQVKNVTQLIAQISHSTLEQADGLSSLTRAVDELNLITQKNAEL
CHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHCCHHH
VEESAQVSAMVKHRASRLEDAVTVLH
HHHHHHHHHHHHHHHHHHHHHHHHCH
>Mature Secondary Structure 
SSHPYVTQQNTPLADDTTLMSTTDLQSYITHANDTFVQVSGYTLQELQGQPHNMVRHPD
CCCCCCCCCCCCCCCCCCHHHHHHHHHHHHCCCCCEEEECCCCHHHHCCCCCCCCCCCC
MPKAAFADMWFTLKKGEPWSGIVKNRRKNGDHYWVRANAVPMVREGKISGYMSIRTRATD
CCHHHHHHHHEEEECCCCCHHHHHHHCCCCCEEEEEECCCCCEECCCCCCEEEEEECCCC
EEIAAVEPLYKALNAGRTSKRIHKGLVVRKGWLGKLPSLPLRWRARGVMTLMFILLAAML
HHHHHHHHHHHHHHCCCHHHHHHHCHHEECCCCCCCCCCCHHHHHHHHHHHHHHHHHHHH
WFVAAPVVTYILCALVVLLASACFEWQIVRPIENVAHQALKVATGERNSVEHLNRSDELG
HHHHHHHHHHHHHHHHHHHHHHHHCHHHHHHHHHHHHHHHHHHCCCCCHHHHCCCCCCCC
LTLRAVGQLGLMCRWLINDVSSQVSSVRNGSETLAKGTDELNEHTQQTVDNVQQTVATMN
HHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHCCHHHHHHHHHHHHHHHHHHHHHHH
QMAASVKQNSATASAADKLSITASNAAVQGGEAMTTVIKTMDDIADSTQRIGTITSLIND
HHHHHHHHCCCHHHHHHCEEEEECCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
IAFQTNILALNAAVEAARAGEQGKGFAVVAGEVRHLASRSANAANDIRKLIDASADKVQS
HHHHHHHHHHHHHHHHHHCCCCCCCEEEEHHHHHHHHHCCCCHHHHHHHHHHCCHHHHHC
GSQQVHAAGRTMEDIVAQVKNVTQLIAQISHSTLEQADGLSSLTRAVDELNLITQKNAEL
CHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHCCHHH
VEESAQVSAMVKHRASRLEDAVTVLH
HHHHHHHHHHHHHHHHHHHHHHHHCH

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 9278503; 9190831; 9380671