The gene/protein map for NC_012731 is currently unavailable.
Definition Klebsiella pneumoniae NTUH-K2044 chromosome, complete genome.
Accession NC_012731
Length 5,248,520

Click here to switch to the map view.

The map label for this gene is gsiB [H]

Identifier: 238893590

GI number: 238893590

Start: 1442714

End: 1444462

Strand: Direct

Name: gsiB [H]

Synonym: KP1_1501

Alternate gene names: 238893590

Gene position: 1442714-1444462 (Clockwise)

Preceding gene: 238893587

Following gene: 238893591

Centisome position: 27.49

GC content: 61.23

Gene sequence:

>1749_bases
TTGGCCTATTTTCGTCCGCGTAAGAGCTGGTACGCATTTTGCCTGTTAATCCGTGACACTTTATTTAACAGGGATCATGT
GATGCACAAAAAGACGTTATTTTCGCGTGCCGGTCGTCTCGCCGTGGCGGTGAGCGGCGCACTGGCCCTGGCGGGCGCCG
CCTTACCTGCCAACGCCTCCACGCTGCGGATCGCCATGACCGCCGCGGATATTCCGTTAACCCTTGGCCAGCCGGATCAA
GGCTATGAGGGCAACCGCTTTACCGGCATCCCGCTGTACGACGCGCTGGTGGAGTGGGATCTGTCGCAAGGTGAAAAGCC
CAGCGGTCTGGTGCCGGGGCTGGCGAACGAGTGGCACATCGATCCGCAGAACACCAGCCGCTGGATTTTCACCCTGCGTC
CGGGGGTGAAGTTTCATGATGGGACGGAGGTGAACGCCGACGCCATCGTCTGGAACGTGGATAAGGTGCTGAATAAAGCG
GCGCCGCAGTACGCCCCGGGTCAGATCGGCAACACCCTGTCGCGCATGCCGACCCTCACCGGCGCAGAGAAAATTGACGA
CCACACCGTGGCGCTGACCACCTCGGAACCGGATGCGCTGCTGCCGTACAACATCACCAACCTGTTTATCGTCTCGCCGA
CGGCGTGGCAGAAGCAGTATGACGCGGTGCCGGCCAGCGTGAGAGATAGCGCCGCGCGCAGCAAACAGGCGTGGACCGCC
TTCGCCGCCCACGCGGTGGGTAGCGGCCCGTTCAAACTGGAGAAGCTGGTGCCGCGTCAGCAGCTGATCCTCGATAAAAA
CCCCGACTACTGGAACAAAGATCGCATTCCCCGGGTGGATAAAGTGGTGCTGATCCCCTTGCCGGAGGCCAACGCCCGTA
CCGCGGCGCTGTTGTCGAAGCAGGTGGACTGGATTGAAGCCCCGGCGCCGGACGCCATCGATCAGATCAAGTCTCAGGGT
TTTCACCTCTACGCCAACACCCAGCCGCATCTGTGGCCCTGGCAGTTCTCCTTTGAAAAAGGATCGCCGTGGCAGGACAT
CCGCGTGCGCAAAGCGGCCAACTTGTGTCTGAACCGTGCCGAGCTGAAGAGCTACCTCGGCGGCTACATGACCGAGGCCA
CTGGGGTCTACGAGGCTGACAGCCCGTGGCATGGCAAACCCACCTTCCAGATAAAATATGACCCGGACGCCGCCCGCCAG
CTAATGACCGAGGCCGGATACAATGCCAGCAAACCGCTGCACGTCACGGTGGCTACCTCGGCCTCCGGCTCCGGGCAGAT
GCAGCCCTTGCCGATGAACGAGTATATCCAGCAGAGCCTGAAGAGCTGCTTCTTCAATGTGGATATCAAAGTGGTGGAAT
GGAACACCCTGTTTACCAACTGGCGCCTGGGCGCCCGGGACCCCTCGGCGAAAGGGATCGATGCGATCAACGTCAGCGCC
GCGGTTAACGATCCTTACTTTGGCCTGATCCGCTTCTCGACGGCCAAAGCGTTTCCGCCGGTGGCGACCAACTGGGGTTA
CTTTTCCACGCCGGAGACGGAGAAGCTGGCCGCCGCCGTCAAGCACGCCTTTACCCCGGCGGAGATGAACAAAGCGGCCG
GTGAGTTGCACGCCGCGCTGGTGGATCAGGTGCCATTCCTGTTTGTCGCCCACGACGTCGGGCCGCGTGCGATTTCCCCT
GCGGTGACCGGGGTGGTGCAACCGCAGAGCTGGTTTATCGACCTCAGCCTGGTGAGCAAAAAAGAGTAA

Upstream 100 bases:

>100_bases
CAACATATTTCCCGCTGGCGGTGCGGCGGAATAAGATGCAATTATTTTCCCATAATTATCATGGTGATAATATAAGTCAT
TCTTATTTTACCGGTCGGTT

Downstream 100 bases:

>100_bases
TCGCGAAAGGGGCGACCGATGATCAATACGCTGCTATACCGCATTCTGCTGGCTATCCCCACCATGCTGGGGGTGGCGGT
GATCTGTTTCATGCTGGTGC

Product: putative family 5 extracellular solute-binding protein

Products: ADP; phosphate; dipeptides [Cytoplasm] [C]

Alternate protein names: NA

Number of amino acids: Translated: 582; Mature: 581

Protein sequence:

>582_residues
MAYFRPRKSWYAFCLLIRDTLFNRDHVMHKKTLFSRAGRLAVAVSGALALAGAALPANASTLRIAMTAADIPLTLGQPDQ
GYEGNRFTGIPLYDALVEWDLSQGEKPSGLVPGLANEWHIDPQNTSRWIFTLRPGVKFHDGTEVNADAIVWNVDKVLNKA
APQYAPGQIGNTLSRMPTLTGAEKIDDHTVALTTSEPDALLPYNITNLFIVSPTAWQKQYDAVPASVRDSAARSKQAWTA
FAAHAVGSGPFKLEKLVPRQQLILDKNPDYWNKDRIPRVDKVVLIPLPEANARTAALLSKQVDWIEAPAPDAIDQIKSQG
FHLYANTQPHLWPWQFSFEKGSPWQDIRVRKAANLCLNRAELKSYLGGYMTEATGVYEADSPWHGKPTFQIKYDPDAARQ
LMTEAGYNASKPLHVTVATSASGSGQMQPLPMNEYIQQSLKSCFFNVDIKVVEWNTLFTNWRLGARDPSAKGIDAINVSA
AVNDPYFGLIRFSTAKAFPPVATNWGYFSTPETEKLAAAVKHAFTPAEMNKAAGELHAALVDQVPFLFVAHDVGPRAISP
AVTGVVQPQSWFIDLSLVSKKE

Sequences:

>Translated_582_residues
MAYFRPRKSWYAFCLLIRDTLFNRDHVMHKKTLFSRAGRLAVAVSGALALAGAALPANASTLRIAMTAADIPLTLGQPDQ
GYEGNRFTGIPLYDALVEWDLSQGEKPSGLVPGLANEWHIDPQNTSRWIFTLRPGVKFHDGTEVNADAIVWNVDKVLNKA
APQYAPGQIGNTLSRMPTLTGAEKIDDHTVALTTSEPDALLPYNITNLFIVSPTAWQKQYDAVPASVRDSAARSKQAWTA
FAAHAVGSGPFKLEKLVPRQQLILDKNPDYWNKDRIPRVDKVVLIPLPEANARTAALLSKQVDWIEAPAPDAIDQIKSQG
FHLYANTQPHLWPWQFSFEKGSPWQDIRVRKAANLCLNRAELKSYLGGYMTEATGVYEADSPWHGKPTFQIKYDPDAARQ
LMTEAGYNASKPLHVTVATSASGSGQMQPLPMNEYIQQSLKSCFFNVDIKVVEWNTLFTNWRLGARDPSAKGIDAINVSA
AVNDPYFGLIRFSTAKAFPPVATNWGYFSTPETEKLAAAVKHAFTPAEMNKAAGELHAALVDQVPFLFVAHDVGPRAISP
AVTGVVQPQSWFIDLSLVSKKE
>Mature_581_residues
AYFRPRKSWYAFCLLIRDTLFNRDHVMHKKTLFSRAGRLAVAVSGALALAGAALPANASTLRIAMTAADIPLTLGQPDQG
YEGNRFTGIPLYDALVEWDLSQGEKPSGLVPGLANEWHIDPQNTSRWIFTLRPGVKFHDGTEVNADAIVWNVDKVLNKAA
PQYAPGQIGNTLSRMPTLTGAEKIDDHTVALTTSEPDALLPYNITNLFIVSPTAWQKQYDAVPASVRDSAARSKQAWTAF
AAHAVGSGPFKLEKLVPRQQLILDKNPDYWNKDRIPRVDKVVLIPLPEANARTAALLSKQVDWIEAPAPDAIDQIKSQGF
HLYANTQPHLWPWQFSFEKGSPWQDIRVRKAANLCLNRAELKSYLGGYMTEATGVYEADSPWHGKPTFQIKYDPDAARQL
MTEAGYNASKPLHVTVATSASGSGQMQPLPMNEYIQQSLKSCFFNVDIKVVEWNTLFTNWRLGARDPSAKGIDAINVSAA
VNDPYFGLIRFSTAKAFPPVATNWGYFSTPETEKLAAAVKHAFTPAEMNKAAGELHAALVDQVPFLFVAHDVGPRAISPA
VTGVVQPQSWFIDLSLVSKKE

Specific function: Part of the ABC transporter complex gsiABCD involved in glutathione import [H]

COG id: NA

COG function: NA

Gene ontology:

Cell location: Periplasm (Potential) [H]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the bacterial solute-binding protein 5 family [H]

Homologues:

Organism=Escherichia coli, GI1789966, Length=548, Percent_Identity=22.992700729927, Blast_Score=93, Evalue=4e-20,
Organism=Escherichia coli, GI1787495, Length=469, Percent_Identity=24.9466950959488, Blast_Score=92, Evalue=8e-20,
Organism=Escherichia coli, GI87081878, Length=501, Percent_Identity=24.5508982035928, Blast_Score=88, Evalue=2e-18,
Organism=Escherichia coli, GI1787052, Length=514, Percent_Identity=24.124513618677, Blast_Score=81, Evalue=2e-16,
Organism=Escherichia coli, GI1787762, Length=296, Percent_Identity=28.7162162162162, Blast_Score=73, Evalue=5e-14,

Paralogues:

None

Copy number: 660 Molecules/Cell In: Growth Phase, Minimal Media (Based on E. coli). 2980 Molecules/Cell In: Growth Phase, Minimal Media (Based on E. coli). 40 Molecules/Cell In: Stationary Phase, Rich Media (Based on E. coli). [C]

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR000914 [H]

Pfam domain/function: PF00496 SBP_bac_5 [H]

EC number: NA

Molecular weight: Translated: 64149; Mature: 64018

Theoretical pI: Translated: 8.40; Mature: 8.40

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.5 %Cys     (Translated Protein)
1.5 %Met     (Translated Protein)
2.1 %Cys+Met (Translated Protein)
0.5 %Cys     (Mature Protein)
1.4 %Met     (Mature Protein)
1.9 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MAYFRPRKSWYAFCLLIRDTLFNRDHVMHKKTLFSRAGRLAVAVSGALALAGAALPANAS
CCCCCCCHHHHHHHHHHHHHHCCCHHHHHHHHHHHHCCCEEEEECCHHHHHCCCCCCCCC
TLRIAMTAADIPLTLGQPDQGYEGNRFTGIPLYDALVEWDLSQGEKPSGLVPGLANEWHI
EEEEEEEECCCEEECCCCCCCCCCCEEECCHHHHHHHHHHCCCCCCCCCCCCCCCCCCCC
DPQNTSRWIFTLRPGVKFHDGTEVNADAIVWNVDKVLNKAAPQYAPGQIGNTLSRMPTLT
CCCCCCEEEEEECCCCEECCCCCCCCCEEEEEHHHHHHHCCCCCCCCHHCCHHHHCCCCC
GAEKIDDHTVALTTSEPDALLPYNITNLFIVSPTAWQKQYDAVPASVRDSAARSKQAWTA
CCCCCCCCEEEEECCCCCCCCCCCCCEEEEECCCHHHHHHCCCCCHHHHHHHHHHHHHHH
FAAHAVGSGPFKLEKLVPRQQLILDKNPDYWNKDRIPRVDKVVLIPLPEANARTAALLSK
HHHHHCCCCCCHHHHHCCHHHEEECCCCCCCCCCCCCCCCEEEEEECCCCCCHHHHHHHH
QVDWIEAPAPDAIDQIKSQGFHLYANTQPHLWPWQFSFEKGSPWQDIRVRKAANLCLNRA
CCCHHCCCCCHHHHHHHHCCEEEEECCCCCCCEEEEECCCCCCHHHHHHHHHHHHHHHHH
ELKSYLGGYMTEATGVYEADSPWHGKPTFQIKYDPDAARQLMTEAGYNASKPLHVTVATS
HHHHHHCCHHHHCCCCEECCCCCCCCCEEEEEECCHHHHHHHHHCCCCCCCCEEEEEEEC
ASGSGQMQPLPMNEYIQQSLKSCFFNVDIKVVEWNTLFTNWRLGARDPSAKGIDAINVSA
CCCCCCCCCCCHHHHHHHHHHHHEEECEEEEEEEEEEEEECCCCCCCCCCCCCCEEEEEE
AVNDPYFGLIRFSTAKAFPPVATNWGYFSTPETEKLAAAVKHAFTPAEMNKAAGELHAAL
EECCCCEEEEEEECCCCCCCCCCCCCCCCCCCHHHHHHHHHHHCCHHHHHHHHHHHHHHH
VDQVPFLFVAHDVGPRAISPAVTGVVQPQSWFIDLSLVSKKE
HHCCCEEEEEECCCCCCCCCHHHEEECCCCEEEEEEEECCCC
>Mature Secondary Structure 
AYFRPRKSWYAFCLLIRDTLFNRDHVMHKKTLFSRAGRLAVAVSGALALAGAALPANAS
CCCCCCHHHHHHHHHHHHHHCCCHHHHHHHHHHHHCCCEEEEECCHHHHHCCCCCCCCC
TLRIAMTAADIPLTLGQPDQGYEGNRFTGIPLYDALVEWDLSQGEKPSGLVPGLANEWHI
EEEEEEEECCCEEECCCCCCCCCCCEEECCHHHHHHHHHHCCCCCCCCCCCCCCCCCCCC
DPQNTSRWIFTLRPGVKFHDGTEVNADAIVWNVDKVLNKAAPQYAPGQIGNTLSRMPTLT
CCCCCCEEEEEECCCCEECCCCCCCCCEEEEEHHHHHHHCCCCCCCCHHCCHHHHCCCCC
GAEKIDDHTVALTTSEPDALLPYNITNLFIVSPTAWQKQYDAVPASVRDSAARSKQAWTA
CCCCCCCCEEEEECCCCCCCCCCCCCEEEEECCCHHHHHHCCCCCHHHHHHHHHHHHHHH
FAAHAVGSGPFKLEKLVPRQQLILDKNPDYWNKDRIPRVDKVVLIPLPEANARTAALLSK
HHHHHCCCCCCHHHHHCCHHHEEECCCCCCCCCCCCCCCCEEEEEECCCCCCHHHHHHHH
QVDWIEAPAPDAIDQIKSQGFHLYANTQPHLWPWQFSFEKGSPWQDIRVRKAANLCLNRA
CCCHHCCCCCHHHHHHHHCCEEEEECCCCCCCEEEEECCCCCCHHHHHHHHHHHHHHHHH
ELKSYLGGYMTEATGVYEADSPWHGKPTFQIKYDPDAARQLMTEAGYNASKPLHVTVATS
HHHHHHCCHHHHCCCCEECCCCCCCCCEEEEEECCHHHHHHHHHCCCCCCCCEEEEEEEC
ASGSGQMQPLPMNEYIQQSLKSCFFNVDIKVVEWNTLFTNWRLGARDPSAKGIDAINVSA
CCCCCCCCCCCHHHHHHHHHHHHEEECEEEEEEEEEEEEECCCCCCCCCCCCCCEEEEEE
AVNDPYFGLIRFSTAKAFPPVATNWGYFSTPETEKLAAAVKHAFTPAEMNKAAGELHAAL
EECCCCEEEEEEECCCCCCCCCCCCCCCCCCCHHHHHHHHHHHCCHHHHHHHHHHHHHHH
VDQVPFLFVAHDVGPRAISPAVTGVVQPQSWFIDLSLVSKKE
HHCCCEEEEEECCCCCCCCCHHHEEECCCCEEEEEEEECCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: ATP; dipeptides [Periplasm]; H2O [C]

Specific reaction: ATP + dipeptides [Periplasm] + H2O = ADP + phosphate + dipeptides [Cytoplasm] [C]

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA