Definition Klebsiella pneumoniae NTUH-K2044 chromosome, complete genome.
Accession NC_012731
Length 5,248,520

Click here to switch to the map view.

The map label for this gene is setA [H]

Identifier: 238893046

GI number: 238893046

Start: 866868

End: 868052

Strand: Direct

Name: setA [H]

Synonym: KP1_0883

Alternate gene names: 238893046

Gene position: 866868-868052 (Clockwise)

Preceding gene: 238893045

Following gene: 238893048

Centisome position: 16.52

GC content: 60.68

Gene sequence:

>1185_bases
ATGCTGTGGTTGATGACGATGGGACGACGGCTTAACGGCGTCTATGCCGCCTTTATGCTGGTTGCTTTTATGATGGGCGT
GGCGGGCGCGTTGCAGGCGCCGACGTTGAGTTTGTTTCTCAGCCGCGAAGTGGGGGCGCAACCGTTCTGGGTGGGCCTGT
TCTATACCGTAAACGCCATCGCCGGGATCCTGGTTAGCCTGTGGCTGGCCAAGCGCTCCGATAGCCGCGGCGACCGGCGG
CGGTTGATTATGTTCTGCTGTCTGATGGCGGTGGGTAATGCGCTGCTGTTTGCCTTCAACCGCCACTATCTGACGCTGAT
CACCTGCGGCGTGATGCTGGCATCCATTGCCAACGCGGCCATGCCGCAGCTCTTCGCGCTGGCGCGGGAGTACGCCGACA
GCTCGGCGCGGGAAGTGGTGATGTTCAGCTCGGTCATGCGCGCCCAGCTGTCGCTGGCTTGGGTGATTGGCCCGCCGCTG
GCCTTTATGCTGGCGCTCAACTATGGCTTCACCACCATGTTCTCCATTGCGGCGGGCATTTTTGTCATTAGCCTCGCTCT
GATTGCCATCAAACTGCCTTCGGTTCCGCGTGTGGAACAGCCCTCGGAGGAGGCGGCGGCGCTAGCGCAGGCCGGCGGCT
GGCAGGACAAGAACGTGCGTATGCTGTTTATCGCCTCCACCCTGATGTGGACCTGCAACACCATGTACATCATTGATATG
CCGCTGTGGATCAGCAGCGATCTCGGGCTTCCCGACAGCCTGGCCGGGATCCTGATGGGCACTGCCGCCGGGCTGGAGAT
ACCGGCGATGATCCTCGCCGGCTACTACGTAAAGCGCTTTGGCAAACGTAAAATGATGGTGGCGGCGGTGGCCGCCGGCG
TGCTGTTTTATGCCGGACTGATCCTGTTTCATGGTCGCACGGCGCTGCTGGCTCTGCAGCTGTTCAATGCCATCTTTATC
GGCATTATCGCCGGGATAGGCATGCTGTGGTTCCAGGATTTAATGCCGGGACGGGCGGGAGCGGCGACCACCCTGTTCAC
CAACAGTATTTCCACCGGCGTGATCCTTGCCGGCGTGATGCAGGGGGCGCTGTCCCAGAGCTATGGTCACGCCAGCGTCT
ACTGGACGATCGCGGCCATTTCGCTGGTGACGCTGTTTTTGACCAGCAAGGTGAAGGATATCTGA

Upstream 100 bases:

>100_bases
TTTGTCCTGCAGCATGAAATCCATAGAGTATAGAATCACCCGCCAGCAGAAAGCCTCTGCTGGCTTTTTTCGTTTTCTTC
GCGTGTGTTAAGGACATTCC

Downstream 100 bases:

>100_bases
CTACTCGCCCCGGCATCGCCGGGGCGACCAGGCCTACTTGAGTTCGATACGCTTAATGTCGCCGATGATAAAAATGTAGG
CAATCACCCCAATCAGCGCC

Product: sugar efflux protein

Products: lactose [Periplasm]; Proton [Cytoplasm] [C]

Alternate protein names: NA

Number of amino acids: Translated: 394; Mature: 394

Protein sequence:

>394_residues
MLWLMTMGRRLNGVYAAFMLVAFMMGVAGALQAPTLSLFLSREVGAQPFWVGLFYTVNAIAGILVSLWLAKRSDSRGDRR
RLIMFCCLMAVGNALLFAFNRHYLTLITCGVMLASIANAAMPQLFALAREYADSSAREVVMFSSVMRAQLSLAWVIGPPL
AFMLALNYGFTTMFSIAAGIFVISLALIAIKLPSVPRVEQPSEEAAALAQAGGWQDKNVRMLFIASTLMWTCNTMYIIDM
PLWISSDLGLPDSLAGILMGTAAGLEIPAMILAGYYVKRFGKRKMMVAAVAAGVLFYAGLILFHGRTALLALQLFNAIFI
GIIAGIGMLWFQDLMPGRAGAATTLFTNSISTGVILAGVMQGALSQSYGHASVYWTIAAISLVTLFLTSKVKDI

Sequences:

>Translated_394_residues
MLWLMTMGRRLNGVYAAFMLVAFMMGVAGALQAPTLSLFLSREVGAQPFWVGLFYTVNAIAGILVSLWLAKRSDSRGDRR
RLIMFCCLMAVGNALLFAFNRHYLTLITCGVMLASIANAAMPQLFALAREYADSSAREVVMFSSVMRAQLSLAWVIGPPL
AFMLALNYGFTTMFSIAAGIFVISLALIAIKLPSVPRVEQPSEEAAALAQAGGWQDKNVRMLFIASTLMWTCNTMYIIDM
PLWISSDLGLPDSLAGILMGTAAGLEIPAMILAGYYVKRFGKRKMMVAAVAAGVLFYAGLILFHGRTALLALQLFNAIFI
GIIAGIGMLWFQDLMPGRAGAATTLFTNSISTGVILAGVMQGALSQSYGHASVYWTIAAISLVTLFLTSKVKDI
>Mature_394_residues
MLWLMTMGRRLNGVYAAFMLVAFMMGVAGALQAPTLSLFLSREVGAQPFWVGLFYTVNAIAGILVSLWLAKRSDSRGDRR
RLIMFCCLMAVGNALLFAFNRHYLTLITCGVMLASIANAAMPQLFALAREYADSSAREVVMFSSVMRAQLSLAWVIGPPL
AFMLALNYGFTTMFSIAAGIFVISLALIAIKLPSVPRVEQPSEEAAALAQAGGWQDKNVRMLFIASTLMWTCNTMYIIDM
PLWISSDLGLPDSLAGILMGTAAGLEIPAMILAGYYVKRFGKRKMMVAAVAAGVLFYAGLILFHGRTALLALQLFNAIFI
GIIAGIGMLWFQDLMPGRAGAATTLFTNSISTGVILAGVMQGALSQSYGHASVYWTIAAISLVTLFLTSKVKDI

Specific function: Involved in the efflux of sugars. The physiological role may be the detoxification of non-metabolizable sugar analogs. Can transport IPTG, lactose and glucose. Has broad substrate specificity, with preferences for glucosides or galactosides with alkyl or

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cell inner membrane; Multi-pass membrane protein [H]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the major facilitator superfamily. Set transporter family [H]

Homologues:

Organism=Escherichia coli, GI48994875, Length=394, Percent_Identity=85.5329949238579, Blast_Score=689, Evalue=0.0,
Organism=Escherichia coli, GI1788495, Length=378, Percent_Identity=52.3809523809524, Blast_Score=369, Evalue=1e-103,
Organism=Escherichia coli, GI1790091, Length=393, Percent_Identity=46.5648854961832, Blast_Score=357, Evalue=1e-100,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR020846
- InterPro:   IPR011701
- InterPro:   IPR016196
- InterPro:   IPR004750 [H]

Pfam domain/function: PF07690 MFS_1 [H]

EC number: NA

Molecular weight: Translated: 42560; Mature: 42560

Theoretical pI: Translated: 9.90; Mature: 9.90

Prosite motif: PS50850 MFS

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.0 %Cys     (Translated Protein)
6.3 %Met     (Translated Protein)
7.4 %Cys+Met (Translated Protein)
1.0 %Cys     (Mature Protein)
6.3 %Met     (Mature Protein)
7.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MLWLMTMGRRLNGVYAAFMLVAFMMGVAGALQAPTLSLFLSREVGAQPFWVGLFYTVNAI
CEEHEEHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHCCCCCHHHHHHHHHHHH
AGILVSLWLAKRSDSRGDRRRLIMFCCLMAVGNALLFAFNRHYLTLITCGVMLASIANAA
HHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHH
MPQLFALAREYADSSAREVVMFSSVMRAQLSLAWVIGPPLAFMLALNYGFTTMFSIAAGI
HHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHEEHHHHHHHHHHHHCCHHHHHHHHHHH
FVISLALIAIKLPSVPRVEQPSEEAAALAQAGGWQDKNVRMLFIASTLMWTCNTMYIIDM
HHHHHHHHHHCCCCCCCCCCCCHHHHHHHHCCCCCCCCEEEEEEHHHHHHHCCEEEEEEE
PLWISSDLGLPDSLAGILMGTAAGLEIPAMILAGYYVKRFGKRKMMVAAVAAGVLFYAGL
CHHCCCCCCCCHHHHHHHHHHHCCCHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHH
ILFHGRTALLALQLFNAIFIGIIAGIGMLWFQDLMPGRAGAATTLFTNSISTGVILAGVM
HHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHCCCCHHHHHHHHH
QGALSQSYGHASVYWTIAAISLVTLFLTSKVKDI
HHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHCCC
>Mature Secondary Structure
MLWLMTMGRRLNGVYAAFMLVAFMMGVAGALQAPTLSLFLSREVGAQPFWVGLFYTVNAI
CEEHEEHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHCCCCCHHHHHHHHHHHH
AGILVSLWLAKRSDSRGDRRRLIMFCCLMAVGNALLFAFNRHYLTLITCGVMLASIANAA
HHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHH
MPQLFALAREYADSSAREVVMFSSVMRAQLSLAWVIGPPLAFMLALNYGFTTMFSIAAGI
HHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHEEHHHHHHHHHHHHCCHHHHHHHHHHH
FVISLALIAIKLPSVPRVEQPSEEAAALAQAGGWQDKNVRMLFIASTLMWTCNTMYIIDM
HHHHHHHHHHCCCCCCCCCCCCHHHHHHHHCCCCCCCCEEEEEEHHHHHHHCCEEEEEEE
PLWISSDLGLPDSLAGILMGTAAGLEIPAMILAGYYVKRFGKRKMMVAAVAAGVLFYAGL
CHHCCCCCCCCHHHHHHHHHHHCCCHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHH
ILFHGRTALLALQLFNAIFIGIIAGIGMLWFQDLMPGRAGAATTLFTNSISTGVILAGVM
HHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHCCCCHHHHHHHHH
QGALSQSYGHASVYWTIAAISLVTLFLTSKVKDI
HHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: lactose [Cytoplasm]; Proton [Periplasm] [C]

Specific reaction: lactose [Cytoplasm] + Proton [Periplasm] = lactose [Periplasm] + Proton [Cytoplasm] [C]

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 1630901; 9278503; 10209755; 10438463 [H]