| Definition | Mesorhizobium loti MAFF303099 plasmid pMLa, complete sequence. |
|---|---|
| Accession | NC_002679 |
| Length | 351,911 |
Click here to switch to the map view.
The map label for this gene is sdiA [C]
Identifier: 13488084
GI number: 13488084
Start: 117543
End: 119981
Strand: Reverse
Name: sdiA [C]
Synonym: mll9138
Alternate gene names: 13488084
Gene position: 119981-117543 (Counterclockwise)
Preceding gene: 13488085
Following gene: 13488083
Centisome position: 34.09
GC content: 61.5
Gene sequence:
>2439_bases ATGACATCGCTTGCCGTCAGTCGGGCATCCAGTATCGCAAATATTGCGCCACCTGGGGCACGGGCGCATAGATATCGCAT AAATGCGGACTTCCCACGCACGGCGATCGTCCACCAGATTCTGGGCCGCCCTGAGGCGATTGTCGTCCTAGAGGCCCCCG CCGGCATGGGCAAGTCGGTGATTTTGGACCAGATCGCCGGGCAGAAAAAGCTCAGGGTTCATGCCGACGCCAACCCGCCG AAGCTGCAAACCAACAGGCTTGCGCTGTGGGACATCCCGCCCCACGCGATTGCGGGACCGTTGCCGGAGCAGCTTCTGTC AGGCGGCAGCCGGGCCATAATCGCTAAACGCCCGGACACGGAAATACCAGGCCTGCCCCGCGCTCTCGCCTATGGCGCGG CACATGTGCTGGATCGGGAGATGCTGCTGGTTTCCGCCGAGGAGGGCGAGCGATTATTTGGACCGAAGCAGGCGAAGCGG ATAATGGCGGTTTCGGGTGGATGGCCGCTCATTGCTTTCCGCGGCGACAGCTCTGGCAACCTGTCGCAGTTCCTGCGCTT CGAGTTTCTCGCTGATATGGTTGACGAAGAATTGGTCGATCTGAAGCTGCTTGCCGAAGGTGCCGCTCTACCGCCTCGCA GCAGTGATGGACTTTTTCCGATAGCGCGGGTGGGACAGAATCGCCGGCTTCAGCTTTGCGCGCAGGGTCTTTCCAGCCAC TTGTCCTCAGCTGTCGAGGCGGTGATATCGGAGCGCCTGTCGACACCTGCGGGCGCCAATGCGATTGCCGAAACCTATGC CGAACACGCAAGGCCGGTGGATGCGATCACCACATACCAACAGGTCGGCTTTTACGACAAGGCGCTGGCCGAGTTCAACC GCGCCGGCGGCCTGTTCTTCATCTACTTCCACGGCACTGCCGCAAACGACCGCGTGCTTGCCGGCTTCCCTGCTAGCTTC GCGCATCAACGCGAAATCCTTGTCCTGTCGCTGGCGCTGCCGTCGCTCAAGCGCGGGGATATTTCCCGGGCACGGCGGCT GATCGCCGACCGGTTCGGCGACAGCGCCAACGATGTCGAGACCGTGTTCGCCTCGCGCACGCTGTTCTCCCGCGAGTTCC GGGAATTCCGCTTCCTGATGCTAATCTATGAGGATCACCAGTTCAGTGAGGAACTGCTCGCCACACTTTTCAACTTGATT GCCGAATTCCCGGGTGACGCGCATCTCTTCCGCGGCACTTTTTACAATTCGATGCTGGAATATTACATCCGCCGCCGCGA ATTCGCCAAGGCCGAGCAGATGGCGCAGCGGGCCATGCATCACTATCAGTCCGCCCATGCGCCGATACTCAGCTTCTATA TCAGCCTCCACCAGGCGATGATGGCGTTGATGAAAGGCGACACGATCGCGGCCGGCAAACATGCGATGCTGTCGGCGAAG AGCCTCTCGGAGGTGCCGTTCGAAACGCTGAACGACATGCGGCTACAGGCGCTCTTGGAGGCTTGCGTCGACTATGACGG CGGCCGGGCCGAATCTTTGGCGCGCTTCCTCAACACCGAAATCGACGATTTTTCGCATGGCGAGATCTGGCCGAGCCTTA TGGAATTCACCCTGCTCTATGGCAGCCAGGCGATGGCCACCCATTTCTCGCTCCTGGCGGCGCGCGGGTTCCTTGACCGC TGGCGGGTGTATCAAATTACCAACCATGCCTTCCAGGCCATGGTCAGCATCCGCGAGGCGATCATCCTCCAGAATGCCAA TCGCTGGTCGGAGGCCGCGACGCGGCTGAGAAGCATCGCCACATCAATCGATCGCGACTGGGTGCTCGCCCATCCCGGCG ACGTGTCCCGCCTGGTCGACCGCGACGATATCGGCTTGCTGCTAGCCTGGCTGCGGCAAATCCTGCATGAGCAACCCGAC CTGCCGCCGATCGAAACGCTGCTCGCCGCTACATTGAGCAATTTGAGTATTACGGACCGGCAGCGTATGGGGGTCAACGT CTGGCTCGCCTATATCCACCGCCGTCGGCGGGATCTCACCAAGGCGCGCGCCATCCTGCTGCGCGTGTTCGAGGATGCGG CCCGGCTGGGTTCGATCGCGCCGCTTGCCGAGGAGAAACTTTTCCTCGGCGAACTGTTGGACAACAAGCGCATCAGCGAA TTCCTCGGCGCTTCGTCATCGGCACGCCAGGTGATCCGCAAACTGCGCGACAGCGGCCATCTGAGCCCCGTTCCCGGCAT CCGCAGCGAACTGTCGCGGCGTGAAAACAAGATTCTGGTGATCGTCTGCGAGGGCGCCGCCAACAAATCGATCGCCGTCA TGCTCGGCGTCAGCGAGGCGACGGTGAAATTTCATCTGGGCAACGTCTATCGCAAGCTCGGCTGCCGGACCCGGCAGGAG GCGATCAGCATCGCCAGGGCTACCGGGATCGTGGGCTAG
Upstream 100 bases:
>100_bases CTTTGGTATCTGGACCGGCGGCAAAGCGGCGTTGCCTGAAACTAAAGATGCCCCAAGGCTCCGCAGGCAGAGGGACCTAA TGTGACAAAACCCATACCTG
Downstream 100 bases:
>100_bases AGCCCCGCAAGCTTTTGTCTGCCGTAAATCGGCCCGGATGTTCCGCTCGCACTCGGTTCCGCGTGCTCTTTGGTACGTCT GCGCCTGTCCACAAATTGCT
Product: two-component regulator
Products: NA
Alternate protein names: Two Component Response Regulator; Two-Component Nodulation Response Regulator Protein
Number of amino acids: Translated: 812; Mature: 811
Protein sequence:
>812_residues MTSLAVSRASSIANIAPPGARAHRYRINADFPRTAIVHQILGRPEAIVVLEAPAGMGKSVILDQIAGQKKLRVHADANPP KLQTNRLALWDIPPHAIAGPLPEQLLSGGSRAIIAKRPDTEIPGLPRALAYGAAHVLDREMLLVSAEEGERLFGPKQAKR IMAVSGGWPLIAFRGDSSGNLSQFLRFEFLADMVDEELVDLKLLAEGAALPPRSSDGLFPIARVGQNRRLQLCAQGLSSH LSSAVEAVISERLSTPAGANAIAETYAEHARPVDAITTYQQVGFYDKALAEFNRAGGLFFIYFHGTAANDRVLAGFPASF AHQREILVLSLALPSLKRGDISRARRLIADRFGDSANDVETVFASRTLFSREFREFRFLMLIYEDHQFSEELLATLFNLI AEFPGDAHLFRGTFYNSMLEYYIRRREFAKAEQMAQRAMHHYQSAHAPILSFYISLHQAMMALMKGDTIAAGKHAMLSAK SLSEVPFETLNDMRLQALLEACVDYDGGRAESLARFLNTEIDDFSHGEIWPSLMEFTLLYGSQAMATHFSLLAARGFLDR WRVYQITNHAFQAMVSIREAIILQNANRWSEAATRLRSIATSIDRDWVLAHPGDVSRLVDRDDIGLLLAWLRQILHEQPD LPPIETLLAATLSNLSITDRQRMGVNVWLAYIHRRRRDLTKARAILLRVFEDAARLGSIAPLAEEKLFLGELLDNKRISE FLGASSSARQVIRKLRDSGHLSPVPGIRSELSRRENKILVIVCEGAANKSIAVMLGVSEATVKFHLGNVYRKLGCRTRQE AISIARATGIVG
Sequences:
>Translated_812_residues MTSLAVSRASSIANIAPPGARAHRYRINADFPRTAIVHQILGRPEAIVVLEAPAGMGKSVILDQIAGQKKLRVHADANPP KLQTNRLALWDIPPHAIAGPLPEQLLSGGSRAIIAKRPDTEIPGLPRALAYGAAHVLDREMLLVSAEEGERLFGPKQAKR IMAVSGGWPLIAFRGDSSGNLSQFLRFEFLADMVDEELVDLKLLAEGAALPPRSSDGLFPIARVGQNRRLQLCAQGLSSH LSSAVEAVISERLSTPAGANAIAETYAEHARPVDAITTYQQVGFYDKALAEFNRAGGLFFIYFHGTAANDRVLAGFPASF AHQREILVLSLALPSLKRGDISRARRLIADRFGDSANDVETVFASRTLFSREFREFRFLMLIYEDHQFSEELLATLFNLI AEFPGDAHLFRGTFYNSMLEYYIRRREFAKAEQMAQRAMHHYQSAHAPILSFYISLHQAMMALMKGDTIAAGKHAMLSAK SLSEVPFETLNDMRLQALLEACVDYDGGRAESLARFLNTEIDDFSHGEIWPSLMEFTLLYGSQAMATHFSLLAARGFLDR WRVYQITNHAFQAMVSIREAIILQNANRWSEAATRLRSIATSIDRDWVLAHPGDVSRLVDRDDIGLLLAWLRQILHEQPD LPPIETLLAATLSNLSITDRQRMGVNVWLAYIHRRRRDLTKARAILLRVFEDAARLGSIAPLAEEKLFLGELLDNKRISE FLGASSSARQVIRKLRDSGHLSPVPGIRSELSRRENKILVIVCEGAANKSIAVMLGVSEATVKFHLGNVYRKLGCRTRQE AISIARATGIVG >Mature_811_residues TSLAVSRASSIANIAPPGARAHRYRINADFPRTAIVHQILGRPEAIVVLEAPAGMGKSVILDQIAGQKKLRVHADANPPK LQTNRLALWDIPPHAIAGPLPEQLLSGGSRAIIAKRPDTEIPGLPRALAYGAAHVLDREMLLVSAEEGERLFGPKQAKRI MAVSGGWPLIAFRGDSSGNLSQFLRFEFLADMVDEELVDLKLLAEGAALPPRSSDGLFPIARVGQNRRLQLCAQGLSSHL SSAVEAVISERLSTPAGANAIAETYAEHARPVDAITTYQQVGFYDKALAEFNRAGGLFFIYFHGTAANDRVLAGFPASFA HQREILVLSLALPSLKRGDISRARRLIADRFGDSANDVETVFASRTLFSREFREFRFLMLIYEDHQFSEELLATLFNLIA EFPGDAHLFRGTFYNSMLEYYIRRREFAKAEQMAQRAMHHYQSAHAPILSFYISLHQAMMALMKGDTIAAGKHAMLSAKS LSEVPFETLNDMRLQALLEACVDYDGGRAESLARFLNTEIDDFSHGEIWPSLMEFTLLYGSQAMATHFSLLAARGFLDRW RVYQITNHAFQAMVSIREAIILQNANRWSEAATRLRSIATSIDRDWVLAHPGDVSRLVDRDDIGLLLAWLRQILHEQPDL PPIETLLAATLSNLSITDRQRMGVNVWLAYIHRRRRDLTKARAILLRVFEDAARLGSIAPLAEEKLFLGELLDNKRISEF LGASSSARQVIRKLRDSGHLSPVPGIRSELSRRENKILVIVCEGAANKSIAVMLGVSEATVKFHLGNVYRKLGCRTRQEA ISIARATGIVG
Specific function: Activates Cell Division By Specifically Increasing Transcription From One Of The Two Promoters That Lie Immediately Upstream Of The Ftsqaz Gene Cluster. [C]
COG id: NA
COG function: NA
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: NA
Homologues:
None
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
NA
Pfam domain/function: NA
EC number: NA
Molecular weight: Translated: 90031; Mature: 89900
Theoretical pI: Translated: 9.26; Mature: 9.26
Prosite motif: PS00622 HTH_LUXR_1 ; PS50043 HTH_LUXR_2
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.5 %Cys (Translated Protein) 2.3 %Met (Translated Protein) 2.8 %Cys+Met (Translated Protein) 0.5 %Cys (Mature Protein) 2.2 %Met (Mature Protein) 2.7 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MTSLAVSRASSIANIAPPGARAHRYRINADFPRTAIVHQILGRPEAIVVLEAPAGMGKSV CCCCHHHHHHHHHCCCCCCCCCEEEEECCCCCHHHHHHHHHCCCCEEEEEECCCCCCHHH ILDQIAGQKKLRVHADANPPKLQTNRLALWDIPPHAIAGPLPEQLLSGGSRAIIAKRPDT HHHHHCCCCEEEEEECCCCCCCCCCCEEEECCCCHHHCCCCHHHHHCCCCEEEEEECCCC EIPGLPRALAYGAAHVLDREMLLVSAEEGERLFGPKQAKRIMAVSGGWPLIAFRGDSSGN CCCCCCHHHHHHHHHHHCHHHEEEECCCCCCCCCHHHHCEEEEEECCCEEEEEECCCCCC LSQFLRFEFLADMVDEELVDLKLLAEGAALPPRSSDGLFPIARVGQNRRLQLCAQGLSSH HHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCHHHHCCCCCHHHHHHHHHHHH LSSAVEAVISERLSTPAGANAIAETYAEHARPVDAITTYQQVGFYDKALAEFNRAGGLFF HHHHHHHHHHHHHCCCCCCHHHHHHHHHHCCCHHHHHHHHHHCHHHHHHHHHHCCCCEEE IYFHGTAANDRVLAGFPASFAHQREILVLSLALPSLKRGDISRARRLIADRFGDSANDVE EEEECCCCCCCEEECCCHHHHCCCCEEEEEECCCCCCCCCHHHHHHHHHHHCCCCCHHHH TVFASRTLFSREFREFRFLMLIYEDHQFSEELLATLFNLIAEFPGDAHLFRGTFYNSMLE HHHHHHHHHHHHHHHHEEEEEEEECCCHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHH YYIRRREFAKAEQMAQRAMHHYQSAHAPILSFYISLHQAMMALMKGDTIAAGKHAMLSAK HHHHHHHHHHHHHHHHHHHHHHHHHCHHHHHHHHHHHHHHHHHHCCCCEECCCHHHHHHH SLSEVPFETLNDMRLQALLEACVDYDGGRAESLARFLNTEIDDFSHGEIWPSLMEFTLLY HHHHCCHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHH GSQAMATHFSLLAARGFLDRWRVYQITNHAFQAMVSIREAIILQNANRWSEAATRLRSIA CCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHH TSIDRDWVLAHPGDVSRLVDRDDIGLLLAWLRQILHEQPDLPPIETLLAATLSNLSITDR HHCCCCEEEECCCCHHHHHCCCCHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHCCCCCHH QRMGVNVWLAYIHRRRRDLTKARAILLRVFEDAARLGSIAPLAEEKLFLGELLDNKRISE HHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHCCHHHHH FLGASSSARQVIRKLRDSGHLSPVPGIRSELSRRENKILVIVCEGAANKSIAVMLGVSEA HHCCCHHHHHHHHHHHHCCCCCCCCCHHHHHHHCCCCEEEEEECCCCCCCEEEEEECCCC TVKFHLGNVYRKLGCRTRQEAISIARATGIVG EEEEHHHHHHHHHCCCHHHHHHHHHHHHCCCC >Mature Secondary Structure TSLAVSRASSIANIAPPGARAHRYRINADFPRTAIVHQILGRPEAIVVLEAPAGMGKSV CCCHHHHHHHHHCCCCCCCCCEEEEECCCCCHHHHHHHHHCCCCEEEEEECCCCCCHHH ILDQIAGQKKLRVHADANPPKLQTNRLALWDIPPHAIAGPLPEQLLSGGSRAIIAKRPDT HHHHHCCCCEEEEEECCCCCCCCCCCEEEECCCCHHHCCCCHHHHHCCCCEEEEEECCCC EIPGLPRALAYGAAHVLDREMLLVSAEEGERLFGPKQAKRIMAVSGGWPLIAFRGDSSGN CCCCCCHHHHHHHHHHHCHHHEEEECCCCCCCCCHHHHCEEEEEECCCEEEEEECCCCCC LSQFLRFEFLADMVDEELVDLKLLAEGAALPPRSSDGLFPIARVGQNRRLQLCAQGLSSH HHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCHHHHCCCCCHHHHHHHHHHHH LSSAVEAVISERLSTPAGANAIAETYAEHARPVDAITTYQQVGFYDKALAEFNRAGGLFF HHHHHHHHHHHHHCCCCCCHHHHHHHHHHCCCHHHHHHHHHHCHHHHHHHHHHCCCCEEE IYFHGTAANDRVLAGFPASFAHQREILVLSLALPSLKRGDISRARRLIADRFGDSANDVE EEEECCCCCCCEEECCCHHHHCCCCEEEEEECCCCCCCCCHHHHHHHHHHHCCCCCHHHH TVFASRTLFSREFREFRFLMLIYEDHQFSEELLATLFNLIAEFPGDAHLFRGTFYNSMLE HHHHHHHHHHHHHHHHEEEEEEEECCCHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHH YYIRRREFAKAEQMAQRAMHHYQSAHAPILSFYISLHQAMMALMKGDTIAAGKHAMLSAK HHHHHHHHHHHHHHHHHHHHHHHHHCHHHHHHHHHHHHHHHHHHCCCCEECCCHHHHHHH SLSEVPFETLNDMRLQALLEACVDYDGGRAESLARFLNTEIDDFSHGEIWPSLMEFTLLY HHHHCCHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHH GSQAMATHFSLLAARGFLDRWRVYQITNHAFQAMVSIREAIILQNANRWSEAATRLRSIA CCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHH TSIDRDWVLAHPGDVSRLVDRDDIGLLLAWLRQILHEQPDLPPIETLLAATLSNLSITDR HHCCCCEEEECCCCHHHHHCCCCHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHCCCCCHH QRMGVNVWLAYIHRRRRDLTKARAILLRVFEDAARLGSIAPLAEEKLFLGELLDNKRISE HHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHCCHHHHH FLGASSSARQVIRKLRDSGHLSPVPGIRSELSRRENKILVIVCEGAANKSIAVMLGVSEA HHCCCHHHHHHHHHHHHCCCCCCCCCHHHHHHHCCCCEEEEEECCCCCCCEEEEEECCCC TVKFHLGNVYRKLGCRTRQEAISIARATGIVG EEEEHHHHHHHHHCCCHHHHHHHHHHHHCCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: DNA [C]
Specific reaction: Protein + DNA = Protein-DNA [C]
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: NA