| Definition | Myxococcus xanthus DK 1622 chromosome, complete genome. |
|---|---|
| Accession | NC_008095 |
| Length | 9,139,763 |
Click here to switch to the map view.
The map label for this gene is atoS [H]
Identifier: 108756970
GI number: 108756970
Start: 5211198
End: 5213321
Strand: Direct
Name: atoS [H]
Synonym: MXAN_4251
Alternate gene names: 108756970
Gene position: 5211198-5213321 (Clockwise)
Preceding gene: 108763070
Following gene: 108761773
Centisome position: 57.02
GC content: 70.57
Gene sequence:
>2124_bases ATGCACGAGTTTCCTTCCCGTCGACAGTTGATGCTGGCCGTCCTGGTGGCCACGACTCTCTCCGCGGCTGTCGAGGGAGT CTGGAGCTACTCCGGGGCGGTGAGCCCCCCTGCTCGCGTCCTCCTCACCGCCGCGGTGGGGCTGCTCATCAGCGGCACCC TGGCGCTGTTGCTCCTGCGAACCCGGGAGCGCGCTCACCGCGCACGGGACGCCGCCCTGCGCAGCGCGGATGACGCCAGC GCGCTTCGCGCAGCCGTCATGGACGTGACGCCCGTGGGCTTCGCCTTCTTCGACCGCGAGCTGCGCTACGTTCACATCAA CACGGCCCTGGCGGCGATGCATGGCCTGCCCACGGAGCGGCACCTGGGCCGGCACGTCACCGAGGTGATGCCCGACCTGG GCAAGCTCATCGCTCCGCGCCTCCAACTGGCGCTCAGCACGGGGGCCTCCATCCAGGACACCCTGCTCCAGGTGGAGACG CCCGCCGCGCCGGGCGAAAGCCGCTTCTGGTTCGGCAGCTATCTGCGCGTGTGCGGCGCGAACGGCGAGGTGCTGGGCGT CATCGCCGCGATGTCCGAGCTCACCGAGCGCATGCGCGCGGAGGAGAGCCTCCAGGAGCACGAGGGCCGGCTGGACGTGC TGACGCGCTCGCTGCCGGACTACCTGTGGGGCGGCAAGCTGCGCGGCGGGAGGCTGCGCGATTTCTACTGCACGCCCGTC ATCGAGCGCACCACCGGCTATGCCGCCTCCGCGTTCGTCCAGCCCGCACCGGATGGCGGACCGCCGCCGCTGTGGGCGGA GATGATCCACCCCGAGGACCGCGCCCGCTACCGGGCCAGCATCGAGGGCCTGGCCCCCGGCGCCGAGGCGGAGCTGGAGC ACCGGCTCATCTGCGCCGACGGCCGCGTGCGTTGGGTGCGCAGCCGCGCCGCCGCTTCCGCGTTGGATGCGCAGGCGGAG CTGCATGTCGGCTGTGTCGTCACCGACATCACCGACCGGCGGCTCGCGGATGACCTGCGCCAGCGCCTGCATGACAGCTT CCGCCGCTCCGCCCAGGAATGGCGCCGCACCTTCGACGCGGTGGCCTCGCCGCTGATGGTGTTGGGGGCGGATGGCACCG TCCAGCGTCTCAACGCCGCCGCCATCGCGCTCTTCGGAGGCATGGACCCGTCCGGCCAGCCGCTGTTCACCGCGGCCAGT GCCCCACCCTGGTCGCACGCACTGCCGTTGGTGGAGGAACTGCGCCGCACCCGCGCCAGCGCCACCCGCGAGCTGGGCGA CCCGGTGTCGCGCCGCACGTGGGAGGTGTCCGCCACCTGGGTGGAGGAAGCCGGCGGCGAGGACTCGCGCATCATCCTGG TGGCCACGGAGGTGACACGTCTCCTGGAGCTCCAGGCCAGCCTGCGGCGCAGTGAGACGATGGCCGCCATGGGCGCCATC GTCGCGGGCGTGGCCCACGAGGTCCGCAACCCCCTCTTCTCCATCTCCGCGGTGGTCGACGCGGTGGAGGCCACCTTCGG CGCGCGCGCGGAGCTCAAGCCCTACGTCGACGTGCTGCGCGGCGAGGTGAAGCGCCTCAACCACCTCACGCAGGAGCTCT TCGAGTACGGCCGCCCCACCCGCGGCGAATGGGTGGAAGGTCCCGTGCTCCCGGTGATGATGGATGCACTCTCCGCATGT GCCCTGGCCAGTGAACGCGCCGGTGTGAATGTGAATCGCGAATTGGCGGCGGAGCTGCCCCGCGTTCGAATGGACGCCCG GCGTTTGTTTCACGTGTTTCGCAACGTGGTGGAGAACGCGGTGCAGCATTCACCGGCGGGCAGCGCGGTGCGGGTGGCGA CGGAAGAAGTGAAAGAGGCGGGCCGGGCCTGGGTGCGGTGCACCGTGCGCGACGGTGGGCCGGGCTTTCGCGCGGAGGAC CTGTCCCACGTCTTCGAGCCCTTCTTCAGCAAGCGGCGCGGCGGCACGGGGCTGGGCCTGTCCATCGTCCAACGCATCCT GGAGGAGCATCAGGGTATCATCCGCTTGCGCAATCACCCGGAGGGCGGCGCGGAAGTCACACTGCTGCTTCCTGCTGTTT CTTCGCGTGTATCAACCCAGCACGTAGACTCCCTGACTTCATGA
Upstream 100 bases:
>100_bases TTCCCTCGTCCGCGGCGCCACCACGGCGGCACGCCAATGCCCGGCGAGCCACCGTCCGACCGGGGATTGCGGTTAAGCTC CCACGCTCGCCGCCCACCGC
Downstream 100 bases:
>100_bases CGCGCACCCGAATCCTTCTCGTGGACGACGAGCCCGGCATCCGCCTGGGCATGAGAGGCTTCCTCACCGCCCATGGGTTC GACGTGGACGAGGCCACCAG
Product: sensory box histidine kinase
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 707; Mature: 707
Protein sequence:
>707_residues MHEFPSRRQLMLAVLVATTLSAAVEGVWSYSGAVSPPARVLLTAAVGLLISGTLALLLLRTRERAHRARDAALRSADDAS ALRAAVMDVTPVGFAFFDRELRYVHINTALAAMHGLPTERHLGRHVTEVMPDLGKLIAPRLQLALSTGASIQDTLLQVET PAAPGESRFWFGSYLRVCGANGEVLGVIAAMSELTERMRAEESLQEHEGRLDVLTRSLPDYLWGGKLRGGRLRDFYCTPV IERTTGYAASAFVQPAPDGGPPPLWAEMIHPEDRARYRASIEGLAPGAEAELEHRLICADGRVRWVRSRAAASALDAQAE LHVGCVVTDITDRRLADDLRQRLHDSFRRSAQEWRRTFDAVASPLMVLGADGTVQRLNAAAIALFGGMDPSGQPLFTAAS APPWSHALPLVEELRRTRASATRELGDPVSRRTWEVSATWVEEAGGEDSRIILVATEVTRLLELQASLRRSETMAAMGAI VAGVAHEVRNPLFSISAVVDAVEATFGARAELKPYVDVLRGEVKRLNHLTQELFEYGRPTRGEWVEGPVLPVMMDALSAC ALASERAGVNVNRELAAELPRVRMDARRLFHVFRNVVENAVQHSPAGSAVRVATEEVKEAGRAWVRCTVRDGGPGFRAED LSHVFEPFFSKRRGGTGLGLSIVQRILEEHQGIIRLRNHPEGGAEVTLLLPAVSSRVSTQHVDSLTS
Sequences:
>Translated_707_residues MHEFPSRRQLMLAVLVATTLSAAVEGVWSYSGAVSPPARVLLTAAVGLLISGTLALLLLRTRERAHRARDAALRSADDAS ALRAAVMDVTPVGFAFFDRELRYVHINTALAAMHGLPTERHLGRHVTEVMPDLGKLIAPRLQLALSTGASIQDTLLQVET PAAPGESRFWFGSYLRVCGANGEVLGVIAAMSELTERMRAEESLQEHEGRLDVLTRSLPDYLWGGKLRGGRLRDFYCTPV IERTTGYAASAFVQPAPDGGPPPLWAEMIHPEDRARYRASIEGLAPGAEAELEHRLICADGRVRWVRSRAAASALDAQAE LHVGCVVTDITDRRLADDLRQRLHDSFRRSAQEWRRTFDAVASPLMVLGADGTVQRLNAAAIALFGGMDPSGQPLFTAAS APPWSHALPLVEELRRTRASATRELGDPVSRRTWEVSATWVEEAGGEDSRIILVATEVTRLLELQASLRRSETMAAMGAI VAGVAHEVRNPLFSISAVVDAVEATFGARAELKPYVDVLRGEVKRLNHLTQELFEYGRPTRGEWVEGPVLPVMMDALSAC ALASERAGVNVNRELAAELPRVRMDARRLFHVFRNVVENAVQHSPAGSAVRVATEEVKEAGRAWVRCTVRDGGPGFRAED LSHVFEPFFSKRRGGTGLGLSIVQRILEEHQGIIRLRNHPEGGAEVTLLLPAVSSRVSTQHVDSLTS >Mature_707_residues MHEFPSRRQLMLAVLVATTLSAAVEGVWSYSGAVSPPARVLLTAAVGLLISGTLALLLLRTRERAHRARDAALRSADDAS ALRAAVMDVTPVGFAFFDRELRYVHINTALAAMHGLPTERHLGRHVTEVMPDLGKLIAPRLQLALSTGASIQDTLLQVET PAAPGESRFWFGSYLRVCGANGEVLGVIAAMSELTERMRAEESLQEHEGRLDVLTRSLPDYLWGGKLRGGRLRDFYCTPV IERTTGYAASAFVQPAPDGGPPPLWAEMIHPEDRARYRASIEGLAPGAEAELEHRLICADGRVRWVRSRAAASALDAQAE LHVGCVVTDITDRRLADDLRQRLHDSFRRSAQEWRRTFDAVASPLMVLGADGTVQRLNAAAIALFGGMDPSGQPLFTAAS APPWSHALPLVEELRRTRASATRELGDPVSRRTWEVSATWVEEAGGEDSRIILVATEVTRLLELQASLRRSETMAAMGAI VAGVAHEVRNPLFSISAVVDAVEATFGARAELKPYVDVLRGEVKRLNHLTQELFEYGRPTRGEWVEGPVLPVMMDALSAC ALASERAGVNVNRELAAELPRVRMDARRLFHVFRNVVENAVQHSPAGSAVRVATEEVKEAGRAWVRCTVRDGGPGFRAED LSHVFEPFFSKRRGGTGLGLSIVQRILEEHQGIIRLRNHPEGGAEVTLLLPAVSSRVSTQHVDSLTS
Specific function: Member of the two-component regulatory system AtoS/AtoC; may activate AtoC by phosphorylation [H]
COG id: COG0642
COG function: function code T; Signal transduction histidine kinase
Gene ontology:
Cell location: Cell inner membrane; Multi-pass membrane protein [H]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 1 PAS (PER-ARNT-SIM) domain [H]
Homologues:
Organism=Escherichia coli, GI1788549, Length=361, Percent_Identity=28.5318559556787, Blast_Score=140, Evalue=4e-34, Organism=Escherichia coli, GI1790436, Length=237, Percent_Identity=30.8016877637131, Blast_Score=116, Evalue=6e-27, Organism=Escherichia coli, GI1788393, Length=239, Percent_Identity=27.6150627615063, Blast_Score=80, Evalue=5e-16, Organism=Escherichia coli, GI1789808, Length=225, Percent_Identity=28.4444444444444, Blast_Score=79, Evalue=1e-15, Organism=Escherichia coli, GI1788713, Length=392, Percent_Identity=22.7040816326531, Blast_Score=76, Evalue=6e-15, Organism=Escherichia coli, GI1790300, Length=243, Percent_Identity=28.8065843621399, Blast_Score=76, Evalue=9e-15, Organism=Escherichia coli, GI1789149, Length=239, Percent_Identity=23.4309623430962, Blast_Score=73, Evalue=7e-14, Organism=Escherichia coli, GI1790551, Length=220, Percent_Identity=30.9090909090909, Blast_Score=72, Evalue=1e-13, Organism=Escherichia coli, GI1790346, Length=227, Percent_Identity=23.3480176211454, Blast_Score=72, Evalue=2e-13, Organism=Escherichia coli, GI1786600, Length=255, Percent_Identity=23.1372549019608, Blast_Score=67, Evalue=4e-12, Organism=Escherichia coli, GI1787894, Length=232, Percent_Identity=25.8620689655172, Blast_Score=64, Evalue=4e-11, Organism=Escherichia coli, GI87081816, Length=233, Percent_Identity=27.4678111587983, Blast_Score=63, Evalue=8e-11,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR003594 - InterPro: IPR003660 - InterPro: IPR000014 - InterPro: IPR000700 - InterPro: IPR013767 - InterPro: IPR004358 - InterPro: IPR003661 - InterPro: IPR005467 - InterPro: IPR009082 [H]
Pfam domain/function: PF00672 HAMP; PF02518 HATPase_c; PF00512 HisKA; PF00989 PAS [H]
EC number: =2.7.13.3 [H]
Molecular weight: Translated: 77150; Mature: 77150
Theoretical pI: Translated: 7.08; Mature: 7.08
Prosite motif: PS50113 PAC ; PS50109 HIS_KIN
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.8 %Cys (Translated Protein) 2.1 %Met (Translated Protein) 3.0 %Cys+Met (Translated Protein) 0.8 %Cys (Mature Protein) 2.1 %Met (Mature Protein) 3.0 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MHEFPSRRQLMLAVLVATTLSAAVEGVWSYSGAVSPPARVLLTAAVGLLISGTLALLLLR CCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHH TRERAHRARDAALRSADDASALRAAVMDVTPVGFAFFDRELRYVHINTALAAMHGLPTER HHHHHHHHHHHHHHCCCHHHHHHHHHHHCCCCHHHHHCCCEEEEEEHHHHHHHHCCCCHH HLGRHVTEVMPDLGKLIAPRLQLALSTGASIQDTLLQVETPAAPGESRFWFGSYLRVCGA HHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHEEECCCCCCCCCCHHHHHHHHHCC NGEVLGVIAAMSELTERMRAEESLQEHEGRLDVLTRSLPDYLWGGKLRGGRLRDFYCTPV CCCHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHCCCCCCCCCCCCEEECCH IERTTGYAASAFVQPAPDGGPPPLWAEMIHPEDRARYRASIEGLAPGAEAELEHRLICAD HHHCCCCHHHCCCCCCCCCCCCCHHHHHCCCHHHHHHHHHHHCCCCCCCCCCCCEEEECC GRVRWVRSRAAASALDAQAELHVGCVVTDITDRRLADDLRQRLHDSFRRSAQEWRRTFDA CCHHHHHHHHHHHHHCCCCCEEEEEEEECCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH VASPLMVLGADGTVQRLNAAAIALFGGMDPSGQPLFTAASAPPWSHALPLVEELRRTRAS HCCCCEEECCCCHHHHHHHHHHHEECCCCCCCCCEEEECCCCCCHHHHHHHHHHHHHHHH ATRELGDPVSRRTWEVSATWVEEAGGEDSRIILVATEVTRLLELQASLRRSETMAAMGAI HHHHHCCCHHCCEEEEEEHHHHHCCCCCCEEEEEHHHHHHHHHHHHHHHHHHHHHHHHHH VAGVAHEVRNPLFSISAVVDAVEATFGARAELKPYVDVLRGEVKRLNHLTQELFEYGRPT HHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCC RGEWVEGPVLPVMMDALSACALASERAGVNVNRELAAELPRVRMDARRLFHVFRNVVENA CCCCCCCCHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHCHHHHHHHHHHHHHHHHHHHHH VQHSPAGSAVRVATEEVKEAGRAWVRCTVRDGGPGFRAEDLSHVFEPFFSKRRGGTGLGL HHCCCCCCEEHHHHHHHHHCCCEEEEEEEECCCCCCCHHHHHHHHHHHHHHCCCCCCCCH SIVQRILEEHQGIIRLRNHPEGGAEVTLLLPAVSSRVSTQHVDSLTS HHHHHHHHHCCCEEEECCCCCCCCEEEEEEHHHHHHHHHHHHHHCCC >Mature Secondary Structure MHEFPSRRQLMLAVLVATTLSAAVEGVWSYSGAVSPPARVLLTAAVGLLISGTLALLLLR CCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHH TRERAHRARDAALRSADDASALRAAVMDVTPVGFAFFDRELRYVHINTALAAMHGLPTER HHHHHHHHHHHHHHCCCHHHHHHHHHHHCCCCHHHHHCCCEEEEEEHHHHHHHHCCCCHH HLGRHVTEVMPDLGKLIAPRLQLALSTGASIQDTLLQVETPAAPGESRFWFGSYLRVCGA HHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHEEECCCCCCCCCCHHHHHHHHHCC NGEVLGVIAAMSELTERMRAEESLQEHEGRLDVLTRSLPDYLWGGKLRGGRLRDFYCTPV CCCHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHCCCCCCCCCCCCEEECCH IERTTGYAASAFVQPAPDGGPPPLWAEMIHPEDRARYRASIEGLAPGAEAELEHRLICAD HHHCCCCHHHCCCCCCCCCCCCCHHHHHCCCHHHHHHHHHHHCCCCCCCCCCCCEEEECC GRVRWVRSRAAASALDAQAELHVGCVVTDITDRRLADDLRQRLHDSFRRSAQEWRRTFDA CCHHHHHHHHHHHHHCCCCCEEEEEEEECCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH VASPLMVLGADGTVQRLNAAAIALFGGMDPSGQPLFTAASAPPWSHALPLVEELRRTRAS HCCCCEEECCCCHHHHHHHHHHHEECCCCCCCCCEEEECCCCCCHHHHHHHHHHHHHHHH ATRELGDPVSRRTWEVSATWVEEAGGEDSRIILVATEVTRLLELQASLRRSETMAAMGAI HHHHHCCCHHCCEEEEEEHHHHHCCCCCCEEEEEHHHHHHHHHHHHHHHHHHHHHHHHHH VAGVAHEVRNPLFSISAVVDAVEATFGARAELKPYVDVLRGEVKRLNHLTQELFEYGRPT HHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCC RGEWVEGPVLPVMMDALSACALASERAGVNVNRELAAELPRVRMDARRLFHVFRNVVENA CCCCCCCCHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHCHHHHHHHHHHHHHHHHHHHHH VQHSPAGSAVRVATEEVKEAGRAWVRCTVRDGGPGFRAEDLSHVFEPFFSKRRGGTGLGL HHCCCCCCEEHHHHHHHHHCCCEEEEEEEECCCCCCCHHHHHHHHHHHHHHCCCCCCCCH SIVQRILEEHQGIIRLRNHPEGGAEVTLLLPAVSSRVSTQHVDSLTS HHHHHHHHHCCCEEEECCCCCCCCEEEEEEHHHHHHHHHHHHHHCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 6.0
TargetDB status: NA
Availability: NA
References: 8346225; 9097040; 9278503 [H]