Definition Mesorhizobium loti MAFF303099 chromosome, complete genome.
Accession NC_002678
Length 7,036,071

Click here to switch to the map view.

The map label for this gene is sorC [H]

Identifier: 13472951

GI number: 13472951

Start: 2737682

End: 2738581

Strand: Reverse

Name: sorC [H]

Synonym: mll3409

Alternate gene names: 13472951

Gene position: 2738581-2737682 (Counterclockwise)

Preceding gene: 13472954

Following gene: 13472950

Centisome position: 38.92

GC content: 67.22

Gene sequence:

>900_bases
ATGCTGCACACGGTGGCCAAGCTGTATTATGTGGAGGAGATGTCGCAGGTCGATATTGCTCGCCGGCTCGGCGTCTCTAC
CGCGACGATTTCGCGCCTGCTGCAGCGGGCGCGGGCTGAGGGCATTGTCCGCATCGAGGTTCTCGACCTGGCGACGCCGG
ACGACATCACCAGGCAGCTGATCGATGGCTTGAAATTGCGCGATGCCGCGGTGGTCGAGACGCCGGCAGCGGGCACGCTG
GCGGCGCTCGCGGCGCCCCTTGGCGGGCTTCTCAGGCAAGCGCAACTGGTGGCGGGCTCCGTCGTCGCCATCGGCTGGGG
GCGCGCCGTGCGCGAGGTCATCCGGGCCGGCCTGCCGCGCATGCCGGGCGTGCTGACCGTGGCTGCCACCGGCGGCATGC
AGCAGCAGGCGGCGCATTTTCAGGTCAACGAATTCGTGCGACTTGCAGCCGAGGAGTTCGGCGGCACCCCGCATTTCATC
CATGCCCCCTATCTGCCCTCTAGCGAATTGCGCGAGGTCTTCCTGCGCGACACCGCCATCCGCGATGCCGTCGCTCTGTG
GGAGAGGACCGATGTCGCGATCGTCGGCATCGGCCTGCCGCATGCCATCAATGCCCCCGAGGCAAGTGCCGCCACGCCGA
GCGAACAAGCGCTGGTTCATGCCGCGGGCGACGTGCTTCGCCATTACTTCGATGCCGAAGGCACGCTGATTGCCTGGGAG
GGCGAGAGCCGGATGATCGCCATGTCGCCGGCGCAGTTGCGCGCCGTGCCGCTGGTCATCGGCCTTGCCGCGTCGCCGGA
AAAGGCGACGGCAATTATTGCAGCCGTTCGCGCGGGTCTCATCAACACGCTGGTGACGGATACCAAGACGGCGCAGGCCA
TCCTCGCAGCGCTCGCGTAA

Upstream 100 bases:

>100_bases
GCGCGATAACTCCCGTCGGCCTATGTGTATGTAACACGTTGCTGAAAGGAATTGCAAGCTGTCTATCCCTCCTCTCCAGG
ATGCGACCGCATCGCGGACA

Downstream 100 bases:

>100_bases
CGAATAGTCCAGGCGGGACGCCGCCACGAAAACCAGTTGTGCCGCCGAAAGGCCCGGGTGATAGTTGACCGGGGCTCGGC
GGAGCAATCGGATGTCGTAC

Product: transcriptional regulator

Products: NA

Alternate protein names: Sor operon activator [H]

Number of amino acids: Translated: 299; Mature: 299

Protein sequence:

>299_residues
MLHTVAKLYYVEEMSQVDIARRLGVSTATISRLLQRARAEGIVRIEVLDLATPDDITRQLIDGLKLRDAAVVETPAAGTL
AALAAPLGGLLRQAQLVAGSVVAIGWGRAVREVIRAGLPRMPGVLTVAATGGMQQQAAHFQVNEFVRLAAEEFGGTPHFI
HAPYLPSSELREVFLRDTAIRDAVALWERTDVAIVGIGLPHAINAPEASAATPSEQALVHAAGDVLRHYFDAEGTLIAWE
GESRMIAMSPAQLRAVPLVIGLAASPEKATAIIAAVRAGLINTLVTDTKTAQAILAALA

Sequences:

>Translated_299_residues
MLHTVAKLYYVEEMSQVDIARRLGVSTATISRLLQRARAEGIVRIEVLDLATPDDITRQLIDGLKLRDAAVVETPAAGTL
AALAAPLGGLLRQAQLVAGSVVAIGWGRAVREVIRAGLPRMPGVLTVAATGGMQQQAAHFQVNEFVRLAAEEFGGTPHFI
HAPYLPSSELREVFLRDTAIRDAVALWERTDVAIVGIGLPHAINAPEASAATPSEQALVHAAGDVLRHYFDAEGTLIAWE
GESRMIAMSPAQLRAVPLVIGLAASPEKATAIIAAVRAGLINTLVTDTKTAQAILAALA
>Mature_299_residues
MLHTVAKLYYVEEMSQVDIARRLGVSTATISRLLQRARAEGIVRIEVLDLATPDDITRQLIDGLKLRDAAVVETPAAGTL
AALAAPLGGLLRQAQLVAGSVVAIGWGRAVREVIRAGLPRMPGVLTVAATGGMQQQAAHFQVNEFVRLAAEEFGGTPHFI
HAPYLPSSELREVFLRDTAIRDAVALWERTDVAIVGIGLPHAINAPEASAATPSEQALVHAAGDVLRHYFDAEGTLIAWE
GESRMIAMSPAQLRAVPLVIGLAASPEKATAIIAAVRAGLINTLVTDTKTAQAILAALA

Specific function: Positively regulates, in the presence of L-sorbose, and negatively regulates, in the absence of L-sorbose, the transcription of the sor operon [H]

COG id: COG2390

COG function: function code K; Transcriptional regulator, contains sigma factor-related N-terminal domain

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the sorC transcriptional regulatory family [H]

Homologues:

Organism=Escherichia coli, GI1787791, Length=311, Percent_Identity=27.9742765273312, Blast_Score=91, Evalue=6e-20,
Organism=Escherichia coli, GI87082414, Length=305, Percent_Identity=24.2622950819672, Blast_Score=74, Evalue=1e-14,

Paralogues:

None

Copy number: 10-20 Molecules/Cell [C]

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR009057
- InterPro:   IPR007630
- InterPro:   IPR007324
- InterPro:   IPR011991 [H]

Pfam domain/function: PF04545 Sigma70_r4; PF04198 Sugar-bind [H]

EC number: NA

Molecular weight: Translated: 31584; Mature: 31584

Theoretical pI: Translated: 6.41; Mature: 6.41

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.0 %Cys     (Translated Protein)
2.0 %Met     (Translated Protein)
2.0 %Cys+Met (Translated Protein)
0.0 %Cys     (Mature Protein)
2.0 %Met     (Mature Protein)
2.0 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MLHTVAKLYYVEEMSQVDIARRLGVSTATISRLLQRARAEGIVRIEVLDLATPDDITRQL
CCHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHCCEEEEEEEECCCCHHHHHHH
IDGLKLRDAAVVETPAAGTLAALAAPLGGLLRQAQLVAGSVVAIGWGRAVREVIRAGLPR
HCCCCCCCCCEEECCCCHHHHHHHHHHHHHHHHHHHHHCCEEEEECCHHHHHHHHCCCCC
MPGVLTVAATGGMQQQAAHFQVNEFVRLAAEEFGGTPHFIHAPYLPSSELREVFLRDTAI
CCCEEEEEECCCCHHHHHHHHHHHHHHHHHHHHCCCCCEEECCCCCHHHHHHHHHHHHHH
RDAVALWERTDVAIVGIGLPHAINAPEASAATPSEQALVHAAGDVLRHYFDAEGTLIAWE
HHHHHHHHCCCEEEEEECCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHCCCCCEEEEE
GESRMIAMSPAQLRAVPLVIGLAASPEKATAIIAAVRAGLINTLVTDTKTAQAILAALA
CCCEEEEECCHHHHHEEEEEEECCCCHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHC
>Mature Secondary Structure
MLHTVAKLYYVEEMSQVDIARRLGVSTATISRLLQRARAEGIVRIEVLDLATPDDITRQL
CCHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHCCEEEEEEEECCCCHHHHHHH
IDGLKLRDAAVVETPAAGTLAALAAPLGGLLRQAQLVAGSVVAIGWGRAVREVIRAGLPR
HCCCCCCCCCEEECCCCHHHHHHHHHHHHHHHHHHHHHCCEEEEECCHHHHHHHHCCCCC
MPGVLTVAATGGMQQQAAHFQVNEFVRLAAEEFGGTPHFIHAPYLPSSELREVFLRDTAI
CCCEEEEEECCCCHHHHHHHHHHHHHHHHHHHHCCCCCEEECCCCCHHHHHHHHHHHHHH
RDAVALWERTDVAIVGIGLPHAINAPEASAATPSEQALVHAAGDVLRHYFDAEGTLIAWE
HHHHHHHHCCCEEEEEECCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHCCCCCEEEEE
GESRMIAMSPAQLRAVPLVIGLAASPEKATAIIAAVRAGLINTLVTDTKTAQAILAALA
CCCEEEEECCHHHHHEEEEEEECCCCHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: 7947968 [H]