The gene/protein map for NC_004631 is currently unavailable.
Definition Salmonella enterica subsp. enterica serovar Typhi str. Ty2 chromosome, complete genome.
Accession NC_004631
Length 4,791,961

Click here to switch to the map view.

The map label for this gene is celR [H]

Identifier: 29144157

GI number: 29144157

Start: 4007605

End: 4008612

Strand: Reverse

Name: celR [H]

Synonym: t3882

Alternate gene names: 29144157

Gene position: 4008612-4007605 (Counterclockwise)

Preceding gene: 29144164

Following gene: 29144156

Centisome position: 83.65

GC content: 59.03

Gene sequence:

>1008_bases
ATGGCTGTTCAAAATAAAAAACGCGCAAAGTTGATTGATGTTGCCCGCCATGCAGGCGTCTCGCCAGGGACGGTATCCAA
TGCATTGCACAACACCCGCTTTGTCGAGCCGCAGACGCGACGGCGTATTGAAGAGGCCATTGTTGCGCTCAACTACACGC
CGAATATTCGCGCTCGCCAGTTACGAACCGGCAAAACCAATACCATTGCTTTGCTCTCTTCGGTGCCGCTGGCGATTGCC
TCCGGCGCATCACGACTGGGATTTATGATGGAGGTGGCGTTAACGTCCGCGATGATGGCGCTGGAAAAACAGCATGCGCT
GATTCTGGTGCCACCAGGGGTAAATCCACTGGATGCCGTCAGCTTTGACGCGGCGATCCTGATTGAGCCGGCGGAGAACG
ACCCGCAGCTCCAGGCGCTGGCGCAAGCGGGCATTCCCTGCGTCACCATTGGCCGCACGCCGGGGACCGACACGCCTGTG
CCGTGGGTTGAGCTGCACTCGGCGGCAACAGCACAGCTTCTGCTAACGCATCTGGAGGCCTCCGGTGCCAGCAAATGTGC
GTTATTTGTCGGTAACACACGGCGAACATCAGTTCTAGAGAGCGAAGCGGCTTACCAGCGCTGGTGCGCGGGGCGCCAGG
ACCCCGTCGTCTACTCTCTCAATGAAAGCGAGGGTGAAAATGCCGGCTACCAGGCCGCGCAGCAGCTATTACAGGCGCAT
CCCGACGTTGACGGCGTGCTGGTGCTGATAGATACCTTTGCCAGCGGCGCGGTACGGGCTTTCCAGGAACAAGACATCGC
CATACCTGAACAAATACGGGTGGTTACTCGCTATGACGGTATCCGCGCGCGCGAATCGCTGCCGCCGCTGACGGCAGTGA
ATATGCATCTTGATGAGGTGGCGCGACAGGCAATCACACTCCTGTTTGCCGTTCTGTCGGGTGAGAAGGTCAGCTACAGC
GACGGGATCATGCCTGAACTGGTGGTGCGAGCGTCAACCTGCCGGTGA

Upstream 100 bases:

>100_bases
TTAATGAAGAGTTTTTTACGATCACCACCGAAAAAAAGCAAACGTTACCGTCTGGTAAATATGCTACCCTGTGCGCAAAT
TTTCGCAGGTCAGGAAGCAG

Downstream 100 bases:

>100_bases
CAGAGGATGACTTGCCACTGCGGGCCGTTGCTGACGCAACGTTCTCTCGCTTCGCTCGAGTCGAACCTCTTGCCCCCGGA
GGTTCTCATCCTCGTCAGGC

Product: LacI family transcriptional regulator

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 335; Mature: 334

Protein sequence:

>335_residues
MAVQNKKRAKLIDVARHAGVSPGTVSNALHNTRFVEPQTRRRIEEAIVALNYTPNIRARQLRTGKTNTIALLSSVPLAIA
SGASRLGFMMEVALTSAMMALEKQHALILVPPGVNPLDAVSFDAAILIEPAENDPQLQALAQAGIPCVTIGRTPGTDTPV
PWVELHSAATAQLLLTHLEASGASKCALFVGNTRRTSVLESEAAYQRWCAGRQDPVVYSLNESEGENAGYQAAQQLLQAH
PDVDGVLVLIDTFASGAVRAFQEQDIAIPEQIRVVTRYDGIRARESLPPLTAVNMHLDEVARQAITLLFAVLSGEKVSYS
DGIMPELVVRASTCR

Sequences:

>Translated_335_residues
MAVQNKKRAKLIDVARHAGVSPGTVSNALHNTRFVEPQTRRRIEEAIVALNYTPNIRARQLRTGKTNTIALLSSVPLAIA
SGASRLGFMMEVALTSAMMALEKQHALILVPPGVNPLDAVSFDAAILIEPAENDPQLQALAQAGIPCVTIGRTPGTDTPV
PWVELHSAATAQLLLTHLEASGASKCALFVGNTRRTSVLESEAAYQRWCAGRQDPVVYSLNESEGENAGYQAAQQLLQAH
PDVDGVLVLIDTFASGAVRAFQEQDIAIPEQIRVVTRYDGIRARESLPPLTAVNMHLDEVARQAITLLFAVLSGEKVSYS
DGIMPELVVRASTCR
>Mature_334_residues
AVQNKKRAKLIDVARHAGVSPGTVSNALHNTRFVEPQTRRRIEEAIVALNYTPNIRARQLRTGKTNTIALLSSVPLAIAS
GASRLGFMMEVALTSAMMALEKQHALILVPPGVNPLDAVSFDAAILIEPAENDPQLQALAQAGIPCVTIGRTPGTDTPVP
WVELHSAATAQLLLTHLEASGASKCALFVGNTRRTSVLESEAAYQRWCAGRQDPVVYSLNESEGENAGYQAAQQLLQAHP
DVDGVLVLIDTFASGAVRAFQEQDIAIPEQIRVVTRYDGIRARESLPPLTAVNMHLDEVARQAITLLFAVLSGEKVSYSD
GIMPELVVRASTCR

Specific function: Binds to the 14-bp operator sequence 5'-TGGGAGCGCTCCCA- 3' in the upstream regions of cellulase genes; these operator sequences are modulated by cellobiose [H]

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 HTH lacI-type DNA-binding domain [H]

Homologues:

Organism=Escherichia coli, GI1790194, Length=317, Percent_Identity=28.0757097791798, Blast_Score=80, Evalue=2e-16,
Organism=Escherichia coli, GI1786540, Length=341, Percent_Identity=26.099706744868, Blast_Score=76, Evalue=4e-15,
Organism=Escherichia coli, GI1790369, Length=350, Percent_Identity=23.7142857142857, Blast_Score=73, Evalue=3e-14,
Organism=Escherichia coli, GI1790715, Length=331, Percent_Identity=23.5649546827795, Blast_Score=68, Evalue=9e-13,
Organism=Escherichia coli, GI1787580, Length=328, Percent_Identity=25, Blast_Score=67, Evalue=2e-12,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR000843
- InterPro:   IPR010982
- InterPro:   IPR001761 [H]

Pfam domain/function: PF00356 LacI; PF00532 Peripla_BP_1 [H]

EC number: NA

Molecular weight: Translated: 36057; Mature: 35926

Theoretical pI: Translated: 6.63; Mature: 6.63

Prosite motif: PS00356 HTH_LACI_1 ; PS50932 HTH_LACI_2

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.2 %Cys     (Translated Protein)
2.1 %Met     (Translated Protein)
3.3 %Cys+Met (Translated Protein)
1.2 %Cys     (Mature Protein)
1.8 %Met     (Mature Protein)
3.0 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MAVQNKKRAKLIDVARHAGVSPGTVSNALHNTRFVEPQTRRRIEEAIVALNYTPNIRARQ
CCCCCCHHHHHHHHHHHCCCCCCHHHHHHHCCCCCCHHHHHHHHHHHEEECCCCCCCHHH
LRTGKTNTIALLSSVPLAIASGASRLGFMMEVALTSAMMALEKQHALILVPPGVNPLDAV
CCCCCCCEEEEEHHCCHHHHCCCHHHHHHHHHHHHHHHHHHHHCCEEEEECCCCCHHHHC
SFDAAILIEPAENDPQLQALAQAGIPCVTIGRTPGTDTPVPWVELHSAATAQLLLTHLEA
CCCEEEEEECCCCCHHHHHHHHCCCCEEEECCCCCCCCCCCHHHHHHHHHHHHHHHHHHC
SGASKCALFVGNTRRTSVLESEAAYQRWCAGRQDPVVYSLNESEGENAGYQAAQQLLQAH
CCCCEEEEEECCCCHHHHHHHHHHHHHHHCCCCCCEEEEECCCCCCCHHHHHHHHHHHHC
PDVDGVLVLIDTFASGAVRAFQEQDIAIPEQIRVVTRYDGIRARESLPPLTAVNMHLDEV
CCCCEEEEEEEHHCCHHHHHHHHCCCCCHHHEEEEECCCCCHHHHCCCCCEEEHHHHHHH
ARQAITLLFAVLSGEKVSYSDGIMPELVVRASTCR
HHHHHHHHHHHHCCCEECCCCCCCHHHHHHHCCCC
>Mature Secondary Structure 
AVQNKKRAKLIDVARHAGVSPGTVSNALHNTRFVEPQTRRRIEEAIVALNYTPNIRARQ
CCCCCHHHHHHHHHHHCCCCCCHHHHHHHCCCCCCHHHHHHHHHHHEEECCCCCCCHHH
LRTGKTNTIALLSSVPLAIASGASRLGFMMEVALTSAMMALEKQHALILVPPGVNPLDAV
CCCCCCCEEEEEHHCCHHHHCCCHHHHHHHHHHHHHHHHHHHHCCEEEEECCCCCHHHHC
SFDAAILIEPAENDPQLQALAQAGIPCVTIGRTPGTDTPVPWVELHSAATAQLLLTHLEA
CCCEEEEEECCCCCHHHHHHHHCCCCEEEECCCCCCCCCCCHHHHHHHHHHHHHHHHHHC
SGASKCALFVGNTRRTSVLESEAAYQRWCAGRQDPVVYSLNESEGENAGYQAAQQLLQAH
CCCCEEEEEECCCCHHHHHHHHHHHHHHHCCCCCCEEEEECCCCCCCHHHHHHHHHHHHC
PDVDGVLVLIDTFASGAVRAFQEQDIAIPEQIRVVTRYDGIRARESLPPLTAVNMHLDEV
CCCCEEEEEEEHHCCHHHHHHHHCCCCCHHHEEEEECCCCCHHHHCCCCCEEEHHHHHHH
ARQAITLLFAVLSGEKVSYSDGIMPELVVRASTCR
HHHHHHHHHHHHCCCEECCCCCCCHHHHHHHCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: 10224066 [H]