Definition Ruegeria sp. TM1040, complete genome.
Accession NC_008044
Length 3,200,938

Click here to switch to the map view.

The map label for this gene is aer [H]

Identifier: 99080421

GI number: 99080421

Start: 618069

End: 619292

Strand: Reverse

Name: aer [H]

Synonym: TM1040_0580

Alternate gene names: 99080421

Gene position: 619292-618069 (Counterclockwise)

Preceding gene: 99080422

Following gene: 99080420

Centisome position: 19.35

GC content: 54.66

Gene sequence:

>1224_bases
GTGTCCTTTGTCGATCGCCGCATTGAAACCCGCCCGAGCAGCGGCGCAGCCCCTTTCGAACTAAACGAGGTCTTTTTCTC
GCGTACCGATGAGCGTGGAGTCATTCTGTCCTGCAACTACGTCTTCCAACGGGTTGCACATTACGAATGGGAAGAGATTA
TCGGAGCGCCCCACAAACTGGTGCGCCATGCCGACACGCCCAAAGGGTTATTCTACCTCTTCTGGGAAATGCTGAAATCC
GGAAAAACCGTTGGTGCATATGTAAAGAACAAGTCCAAGGATGGGCTGCACTACTGGGTTTTTGCAACTGTTGTTCCCTG
TGGCGACGGCTATCTGTCCGCACGTATAAAGCCAAGCAGCAAGCTTTTTGCCGAGATCCAGACGCTCTACGCCAAGATTG
TCAAAGCCGAACAAGAGGGTGATCTATCCGCCGAGGAAAGCGCTCAGATCATGCTCGACTGGGTTCACGAAAAGGGCTTT
GACGACTATCAGCATTTTGCATCGCATGCCCTCGCCGAGGAACTCATTTCGCGCGATTTGGGCCTGGGTCGCAAGGTGGA
TCCGCAGATTTCGGAACTGCGTGAAATGCTGCGCAATGCGGAAAAGCTTCTCGATGAAACCCATGGTCTTGTGAAAGACT
TCGAAGCCATGCACACGATTCCGCATAACCTGCGTGTCATCGCCTCCCGGATTGAGCCTTCGGGCGGTCCGGTGACGGTG
CTGTCCCAGAACTATGGCGCTATGTCGCGCGAAATGTCGGATTGGTTTGAGCGCAACGTGATGGGCGAAAACACCAACTT
TGCCACCGTAAAGCACTCCGTGAACTCCAGCCTCTTTATTGCGGGCATGACCCGAATCCTGATGGAATGCGACACCCAGC
TGCAAAAGGAACGGCGTGATCTGGGCGATGTCGACATGGAAGAAGAGCGCCGCCGCCTTGCGGATCTGGTCAAACAACAG
GCCGGACACGCCCAGAAAGGCATGGCGGAGGTAGACATCGAAGCCGTGCGGATCATCAATGCGTGCCAGGTCATGCATCG
TCACTTTCTGGGCCTGAGCTCCACACGCGTCCTCTGTAAAATCGAGAGTGCGCGCCTGCCCTCCTCTGGCGAAACCCTTT
CTGACATTATCGATCAGCTTGGTGCCTTTCAGGAACGCATTTCGGAACGGTTGGAACATATCGCAAAACTCGGAGAGGAA
ATTCGCTCGCTCGAGGGCGAGTAA

Upstream 100 bases:

>100_bases
GGCACAGTTAAAAGGTGATAGTCCCCTACCCGTTTAAGGATGTGTGAACCACTGGACAGGTAGGTTGGCTTGAAACAAAT
CATCAGATGGAATCGCTTTC

Downstream 100 bases:

>100_bases
CTCATGCCCAAAATCGGTCAGCGCTCCCCGCAGGCCCACAGATACCGCAAATGCGGCGGCTCTCTCGAGCTGCCGCTTTT
TTTAACCTGATCGTGACAGA

Product: hypothetical protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 407; Mature: 406

Protein sequence:

>407_residues
MSFVDRRIETRPSSGAAPFELNEVFFSRTDERGVILSCNYVFQRVAHYEWEEIIGAPHKLVRHADTPKGLFYLFWEMLKS
GKTVGAYVKNKSKDGLHYWVFATVVPCGDGYLSARIKPSSKLFAEIQTLYAKIVKAEQEGDLSAEESAQIMLDWVHEKGF
DDYQHFASHALAEELISRDLGLGRKVDPQISELREMLRNAEKLLDETHGLVKDFEAMHTIPHNLRVIASRIEPSGGPVTV
LSQNYGAMSREMSDWFERNVMGENTNFATVKHSVNSSLFIAGMTRILMECDTQLQKERRDLGDVDMEEERRRLADLVKQQ
AGHAQKGMAEVDIEAVRIINACQVMHRHFLGLSSTRVLCKIESARLPSSGETLSDIIDQLGAFQERISERLEHIAKLGEE
IRSLEGE

Sequences:

>Translated_407_residues
MSFVDRRIETRPSSGAAPFELNEVFFSRTDERGVILSCNYVFQRVAHYEWEEIIGAPHKLVRHADTPKGLFYLFWEMLKS
GKTVGAYVKNKSKDGLHYWVFATVVPCGDGYLSARIKPSSKLFAEIQTLYAKIVKAEQEGDLSAEESAQIMLDWVHEKGF
DDYQHFASHALAEELISRDLGLGRKVDPQISELREMLRNAEKLLDETHGLVKDFEAMHTIPHNLRVIASRIEPSGGPVTV
LSQNYGAMSREMSDWFERNVMGENTNFATVKHSVNSSLFIAGMTRILMECDTQLQKERRDLGDVDMEEERRRLADLVKQQ
AGHAQKGMAEVDIEAVRIINACQVMHRHFLGLSSTRVLCKIESARLPSSGETLSDIIDQLGAFQERISERLEHIAKLGEE
IRSLEGE
>Mature_406_residues
SFVDRRIETRPSSGAAPFELNEVFFSRTDERGVILSCNYVFQRVAHYEWEEIIGAPHKLVRHADTPKGLFYLFWEMLKSG
KTVGAYVKNKSKDGLHYWVFATVVPCGDGYLSARIKPSSKLFAEIQTLYAKIVKAEQEGDLSAEESAQIMLDWVHEKGFD
DYQHFASHALAEELISRDLGLGRKVDPQISELREMLRNAEKLLDETHGLVKDFEAMHTIPHNLRVIASRIEPSGGPVTVL
SQNYGAMSREMSDWFERNVMGENTNFATVKHSVNSSLFIAGMTRILMECDTQLQKERRDLGDVDMEEERRRLADLVKQQA
GHAQKGMAEVDIEAVRIINACQVMHRHFLGLSSTRVLCKIESARLPSSGETLSDIIDQLGAFQERISERLEHIAKLGEEI
RSLEGE

Specific function: Signal transducer for aerotaxis. The aerotactic response is the accumulation of cells around air bubbles. The nature of the sensory stimulus detected by this protein is the proton motive force or cellular redox state. It uses a FAD prosthetic group as a r

COG id: COG2202

COG function: function code T; FOG: PAS/PAC domain

Gene ontology:

Cell location: Cell inner membrane; Multi-pass membrane protein [H]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 PAS (PER-ARNT-SIM) domain [H]

Homologues:

Organism=Escherichia coli, GI1789453, Length=118, Percent_Identity=36.4406779661017, Blast_Score=87, Evalue=3e-18,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR004090
- InterPro:   IPR004089
- InterPro:   IPR003660
- InterPro:   IPR001610
- InterPro:   IPR000014
- InterPro:   IPR013655 [H]

Pfam domain/function: PF00672 HAMP; PF00015 MCPsignal; PF08447 PAS_3 [H]

EC number: NA

Molecular weight: Translated: 46143; Mature: 46012

Theoretical pI: Translated: 5.88; Mature: 5.88

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.2 %Cys     (Translated Protein)
3.2 %Met     (Translated Protein)
4.4 %Cys+Met (Translated Protein)
1.2 %Cys     (Mature Protein)
3.0 %Met     (Mature Protein)
4.2 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSFVDRRIETRPSSGAAPFELNEVFFSRTDERGVILSCNYVFQRVAHYEWEEIIGAPHKL
CCCHHHHHHCCCCCCCCCCCHHHHHHHCCCCCCEEEEHHHHHHHHHHCCHHHHHCCHHHH
VRHADTPKGLFYLFWEMLKSGKTVGAYVKNKSKDGLHYWVFATVVPCGDGYLSARIKPSS
HHCCCCCCHHHHHHHHHHHCCCEEEHHHHCCCCCCCEEEEEEEEEECCCCEEEEEECCHH
KLFAEIQTLYAKIVKAEQEGDLSAEESAQIMLDWVHEKGFDDYQHFASHALAEELISRDL
HHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHC
GLGRKVDPQISELREMLRNAEKLLDETHGLVKDFEAMHTIPHNLRVIASRIEPSGGPVTV
CCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHCCCCCCCEEE
LSQNYGAMSREMSDWFERNVMGENTNFATVKHSVNSSLFIAGMTRILMECDTQLQKERRD
EECCCCHHHHHHHHHHHHCCCCCCCCEEEEECCCCCCHHHHHHHHHHHHHHHHHHHHHHC
LGDVDMEEERRRLADLVKQQAGHAQKGMAEVDIEAVRIINACQVMHRHFLGLSSTRVLCK
CCCCCHHHHHHHHHHHHHHHCCCHHCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCEEEEE
IESARLPSSGETLSDIIDQLGAFQERISERLEHIAKLGEEIRSLEGE
EECCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCC
>Mature Secondary Structure 
SFVDRRIETRPSSGAAPFELNEVFFSRTDERGVILSCNYVFQRVAHYEWEEIIGAPHKL
CCHHHHHHCCCCCCCCCCCHHHHHHHCCCCCCEEEEHHHHHHHHHHCCHHHHHCCHHHH
VRHADTPKGLFYLFWEMLKSGKTVGAYVKNKSKDGLHYWVFATVVPCGDGYLSARIKPSS
HHCCCCCCHHHHHHHHHHHCCCEEEHHHHCCCCCCCEEEEEEEEEECCCCEEEEEECCHH
KLFAEIQTLYAKIVKAEQEGDLSAEESAQIMLDWVHEKGFDDYQHFASHALAEELISRDL
HHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHC
GLGRKVDPQISELREMLRNAEKLLDETHGLVKDFEAMHTIPHNLRVIASRIEPSGGPVTV
CCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHCCCCCCCEEE
LSQNYGAMSREMSDWFERNVMGENTNFATVKHSVNSSLFIAGMTRILMECDTQLQKERRD
EECCCCHHHHHHHHHHHHCCCCCCCCEEEEECCCCCCHHHHHHHHHHHHHHHHHHHHHHC
LGDVDMEEERRRLADLVKQQAGHAQKGMAEVDIEAVRIINACQVMHRHFLGLSSTRVLCK
CCCCCHHHHHHHHHHHHHHHCCCHHCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCEEEEE
IESARLPSSGETLSDIIDQLGAFQERISERLEHIAKLGEEIRSLEGE
EECCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 9278503; 9190831; 9380671 [H]