The gene/protein map for NC_007948 is currently unavailable.
Definition Polaromonas sp. JS666 chromosome, complete genome.
Accession NC_007948
Length 5,200,264

Click here to switch to the map view.

The map label for this gene is gsiB [H]

Identifier: 91790226

GI number: 91790226

Start: 4636214

End: 4637779

Strand: Reverse

Name: gsiB [H]

Synonym: Bpro_4392

Alternate gene names: 91790226

Gene position: 4637779-4636214 (Counterclockwise)

Preceding gene: 91790227

Following gene: 91790225

Centisome position: 89.18

GC content: 60.73

Gene sequence:

>1566_bases
ATGCGCCATAGTTTTCCGTCCGTCACCCGTCCGCTCACCGCCGCGGGCCTTGCCCTGATGCTGCTCGGCGGTGCCGGCCA
TGCTGCAGCCGAGACCAGCTTGACCTATGTCCAAGGCACAGAGATCGACACACTCGATCCAGCCGTGAGCCGTAGCACCC
CCTCGCAAATCGTCATCACGCATATTTTTAACAAATTGGTGAGCTGGGACGGTCCTGGCTTCAAGAAGATCGTTCCTGAC
CTTGCGGAGTCATGGAACGTCTCTGCTGACGGGAAGGTCTGGACTTTCAATCTTCGCAAAGGAGTGAAATTCCATGATGG
GACGCCACTGGACGCGGCGGCTGTCAAGTTCAACCTGGACCGTTTGCGCAGTCCCGAACTGGGTTCGCCGAACCGGTCCT
ACTACGCTGCTATTGAGACGGTAGAGGCCCCGAGCACGTACGTCGTGACCATTGCCGCCAAGGAACCGTCGCCCACACTG
CTTGAGATTCTGACCGAGGAATGGGCGTCCATCAGCAGCCCCACAGCCATCGAAAAGCGTGGTCGCGCCTATGGCCGCAA
CCCCGTGGGTACCGGACCCTATGTATTCAAGAGCTGGATTCCCAATGAGCGCGCCGAGATTGTGCGCAACCCTGACTACT
TCGGCACTCCCGGGAAAACAGACCGACTGGTGTTTCGCCCCGTGCCGGAGAATGCTGCGCGCGTGATCGAGCTGAAGACC
GGAAACGCGGACGTTGCCGCGAACATTGCGCCGGAACTCACCGGTGACTTCAAGGGCAGCGACAAAATGGTGCTGCAACA
AGCCCCTAGTGCCTTTCAGGTGTTCTTCGAGCTGAACGTCACCAAGCCCCCCTTTGACGACGTGCGCGTACGCAAGGCGG
TGAATGTGGCCATAGACCGCCAAGCCATCGTCGACAAGATCCTGCTGGGCTATGGCCGCGTTCCCGTCAGCCCCTTTCCA
GAGGGAACGCAGGCTCGCCGCATATTTCCGGCTTACAAATACAACCCGGACGAGGCGCGCCGCCTGCTGAAGGCCGCATT
CCCTGGTGGGTACCCCGGTGTCGTGACCATGTGGACTCCCTCGGGCCGTTACACAAAGGATCGTGCCGCCGCCGAAGCCG
TACAGGGCTACCTCAACGCCGTCGGTCTGAAGACGGAGTTCAAGGTCTGGGAGTGGGCCTCCTACCAGAAGGAGCTGTAC
CGCGCCGAGCCCGGCAAGGGTACGGGCAAGGGAAGCAACGGCGCCAACATGTGGCTGCTGGGCACCGGCATCCCGAATGC
GGATATCCGCCTGCGCCGCAAGCTGAGCACGGGCGACCCGTCCAACCTCACCGGCTACTCCAACCCGATGGTCGACGGCC
TGCTGGCCAAAGCTGCCGGCGAGATGAACTACGACAAACGCATGGCGACGTACGGCGACGTCCAGCGTGTCGTCTGGGAG
CTCGAACCCAACACGATACCGCTATTTGACCAGGTTCAACTCATCGGCCAACGCAAGGGCGTCAAGGGTCTGACCGTCTA
TAGCGACGAGATCGTCGAATTTAACAACGCAACCGTCACCCGCTAA

Upstream 100 bases:

>100_bases
GGCGCTGAAACCCCGTCAGATTAATCCTCCACGCTCCAAGACCTCCATCCGATTCCAATCCTGCATCCGTCATTGCCTTC
CAAACTCCGGAGTACCCTCC

Downstream 100 bases:

>100_bases
CCCACTTGATGCCAACTTTCAAAGTCCCGATGACATCCACTACCCTTCATGAAACTCTGCTGACCGAAGCCCGGTTGAGC
GCTCCCCCGGCCGCACGGCT

Product: extracellular solute-binding protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 521; Mature: 521

Protein sequence:

>521_residues
MRHSFPSVTRPLTAAGLALMLLGGAGHAAAETSLTYVQGTEIDTLDPAVSRSTPSQIVITHIFNKLVSWDGPGFKKIVPD
LAESWNVSADGKVWTFNLRKGVKFHDGTPLDAAAVKFNLDRLRSPELGSPNRSYYAAIETVEAPSTYVVTIAAKEPSPTL
LEILTEEWASISSPTAIEKRGRAYGRNPVGTGPYVFKSWIPNERAEIVRNPDYFGTPGKTDRLVFRPVPENAARVIELKT
GNADVAANIAPELTGDFKGSDKMVLQQAPSAFQVFFELNVTKPPFDDVRVRKAVNVAIDRQAIVDKILLGYGRVPVSPFP
EGTQARRIFPAYKYNPDEARRLLKAAFPGGYPGVVTMWTPSGRYTKDRAAAEAVQGYLNAVGLKTEFKVWEWASYQKELY
RAEPGKGTGKGSNGANMWLLGTGIPNADIRLRRKLSTGDPSNLTGYSNPMVDGLLAKAAGEMNYDKRMATYGDVQRVVWE
LEPNTIPLFDQVQLIGQRKGVKGLTVYSDEIVEFNNATVTR

Sequences:

>Translated_521_residues
MRHSFPSVTRPLTAAGLALMLLGGAGHAAAETSLTYVQGTEIDTLDPAVSRSTPSQIVITHIFNKLVSWDGPGFKKIVPD
LAESWNVSADGKVWTFNLRKGVKFHDGTPLDAAAVKFNLDRLRSPELGSPNRSYYAAIETVEAPSTYVVTIAAKEPSPTL
LEILTEEWASISSPTAIEKRGRAYGRNPVGTGPYVFKSWIPNERAEIVRNPDYFGTPGKTDRLVFRPVPENAARVIELKT
GNADVAANIAPELTGDFKGSDKMVLQQAPSAFQVFFELNVTKPPFDDVRVRKAVNVAIDRQAIVDKILLGYGRVPVSPFP
EGTQARRIFPAYKYNPDEARRLLKAAFPGGYPGVVTMWTPSGRYTKDRAAAEAVQGYLNAVGLKTEFKVWEWASYQKELY
RAEPGKGTGKGSNGANMWLLGTGIPNADIRLRRKLSTGDPSNLTGYSNPMVDGLLAKAAGEMNYDKRMATYGDVQRVVWE
LEPNTIPLFDQVQLIGQRKGVKGLTVYSDEIVEFNNATVTR
>Mature_521_residues
MRHSFPSVTRPLTAAGLALMLLGGAGHAAAETSLTYVQGTEIDTLDPAVSRSTPSQIVITHIFNKLVSWDGPGFKKIVPD
LAESWNVSADGKVWTFNLRKGVKFHDGTPLDAAAVKFNLDRLRSPELGSPNRSYYAAIETVEAPSTYVVTIAAKEPSPTL
LEILTEEWASISSPTAIEKRGRAYGRNPVGTGPYVFKSWIPNERAEIVRNPDYFGTPGKTDRLVFRPVPENAARVIELKT
GNADVAANIAPELTGDFKGSDKMVLQQAPSAFQVFFELNVTKPPFDDVRVRKAVNVAIDRQAIVDKILLGYGRVPVSPFP
EGTQARRIFPAYKYNPDEARRLLKAAFPGGYPGVVTMWTPSGRYTKDRAAAEAVQGYLNAVGLKTEFKVWEWASYQKELY
RAEPGKGTGKGSNGANMWLLGTGIPNADIRLRRKLSTGDPSNLTGYSNPMVDGLLAKAAGEMNYDKRMATYGDVQRVVWE
LEPNTIPLFDQVQLIGQRKGVKGLTVYSDEIVEFNNATVTR

Specific function: Part of the ABC transporter complex gsiABCD involved in glutathione import [H]

COG id: COG0747

COG function: function code E; ABC-type dipeptide transport system, periplasmic component

Gene ontology:

Cell location: Periplasm (Potential) [H]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the bacterial solute-binding protein 5 family [H]

Homologues:

Organism=Escherichia coli, GI1787052, Length=519, Percent_Identity=31.4065510597302, Blast_Score=209, Evalue=4e-55,
Organism=Escherichia coli, GI1787762, Length=508, Percent_Identity=26.5748031496063, Blast_Score=154, Evalue=2e-38,
Organism=Escherichia coli, GI1787495, Length=508, Percent_Identity=26.5748031496063, Blast_Score=142, Evalue=7e-35,
Organism=Escherichia coli, GI1789966, Length=547, Percent_Identity=26.691042047532, Blast_Score=137, Evalue=2e-33,
Organism=Escherichia coli, GI87081878, Length=533, Percent_Identity=24.390243902439, Blast_Score=113, Evalue=3e-26,
Organism=Escherichia coli, GI1789887, Length=340, Percent_Identity=28.5294117647059, Blast_Score=112, Evalue=4e-26,
Organism=Escherichia coli, GI1787551, Length=509, Percent_Identity=23.1827111984283, Blast_Score=107, Evalue=2e-24,
Organism=Escherichia coli, GI1789397, Length=496, Percent_Identity=24.7983870967742, Blast_Score=101, Evalue=1e-22,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR000914 [H]

Pfam domain/function: PF00496 SBP_bac_5 [H]

EC number: NA

Molecular weight: Translated: 57129; Mature: 57129

Theoretical pI: Translated: 9.66; Mature: 9.66

Prosite motif: PS01040 SBP_BACTERIAL_5

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.0 %Cys     (Translated Protein)
1.5 %Met     (Translated Protein)
1.5 %Cys+Met (Translated Protein)
0.0 %Cys     (Mature Protein)
1.5 %Met     (Mature Protein)
1.5 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MRHSFPSVTRPLTAAGLALMLLGGAGHAAAETSLTYVQGTEIDTLDPAVSRSTPSQIVIT
CCCCCCCHHCHHHHHHHHHEEECCCCCCHHCCEEEEEECCCCCCCCCHHCCCCCCHHHHH
HIFNKLVSWDGPGFKKIVPDLAESWNVSADGKVWTFNLRKGVKFHDGTPLDAAAVKFNLD
HHHHHHHCCCCCCHHHHHHHHHHHCCCCCCCEEEEEECCCCCEECCCCCCCHHEEEEEHH
RLRSPELGSPNRSYYAAIETVEAPSTYVVTIAAKEPSPTLLEILTEEWASISSPTAIEKR
HCCCCCCCCCCCCEEEEEEEECCCCEEEEEEEECCCCHHHHHHHHHHHHCCCCCHHHHHH
GRAYGRNPVGTGPYVFKSWIPNERAEIVRNPDYFGTPGKTDRLVFRPVPENAARVIELKT
CHHCCCCCCCCCCHHHHHCCCCCHHHHCCCCCCCCCCCCCCEEEEEECCCCCEEEEEEEC
GNADVAANIAPELTGDFKGSDKMVLQQAPSAFQVFFELNVTKPPFDDVRVRKAVNVAIDR
CCCCEEECCCCCCCCCCCCCCCHHHHHCCCEEEEEEEEECCCCCHHHHHHHHHHHHHHHH
QAIVDKILLGYGRVPVSPFPEGTQARRIFPAYKYNPDEARRLLKAAFPGGYPGVVTMWTP
HHHHHHHHHHCCCCCCCCCCCCCCCCEECCCCCCCHHHHHHHHHHHCCCCCCCEEEEECC
SGRYTKDRAAAEAVQGYLNAVGLKTEFKVWEWASYQKELYRAEPGKGTGKGSNGANMWLL
CCCCCHHHHHHHHHHHHHHHHCCCEEEEEHHHHHHHHHHHHCCCCCCCCCCCCCCEEEEE
GTGIPNADIRLRRKLSTGDPSNLTGYSNPMVDGLLAKAAGEMNYDKRMATYGDVQRVVWE
ECCCCCCCEEEEEECCCCCCCCCCCCCCHHHHHHHHHHHCCCCHHHHHHHHHHHEEEEEE
LEPNTIPLFDQVQLIGQRKGVKGLTVYSDEIVEFNNATVTR
ECCCCCCHHHHHHHHHHHCCCCEEEEECCCEEEECCCCCCC
>Mature Secondary Structure
MRHSFPSVTRPLTAAGLALMLLGGAGHAAAETSLTYVQGTEIDTLDPAVSRSTPSQIVIT
CCCCCCCHHCHHHHHHHHHEEECCCCCCHHCCEEEEEECCCCCCCCCHHCCCCCCHHHHH
HIFNKLVSWDGPGFKKIVPDLAESWNVSADGKVWTFNLRKGVKFHDGTPLDAAAVKFNLD
HHHHHHHCCCCCCHHHHHHHHHHHCCCCCCCEEEEEECCCCCEECCCCCCCHHEEEEEHH
RLRSPELGSPNRSYYAAIETVEAPSTYVVTIAAKEPSPTLLEILTEEWASISSPTAIEKR
HCCCCCCCCCCCCEEEEEEEECCCCEEEEEEEECCCCHHHHHHHHHHHHCCCCCHHHHHH
GRAYGRNPVGTGPYVFKSWIPNERAEIVRNPDYFGTPGKTDRLVFRPVPENAARVIELKT
CHHCCCCCCCCCCHHHHHCCCCCHHHHCCCCCCCCCCCCCCEEEEEECCCCCEEEEEEEC
GNADVAANIAPELTGDFKGSDKMVLQQAPSAFQVFFELNVTKPPFDDVRVRKAVNVAIDR
CCCCEEECCCCCCCCCCCCCCCHHHHHCCCEEEEEEEEECCCCCHHHHHHHHHHHHHHHH
QAIVDKILLGYGRVPVSPFPEGTQARRIFPAYKYNPDEARRLLKAAFPGGYPGVVTMWTP
HHHHHHHHHHCCCCCCCCCCCCCCCCEECCCCCCCHHHHHHHHHHHCCCCCCCEEEEECC
SGRYTKDRAAAEAVQGYLNAVGLKTEFKVWEWASYQKELYRAEPGKGTGKGSNGANMWLL
CCCCCHHHHHHHHHHHHHHHHCCCEEEEEHHHHHHHHHHHHCCCCCCCCCCCCCCEEEEE
GTGIPNADIRLRRKLSTGDPSNLTGYSNPMVDGLLAKAAGEMNYDKRMATYGDVQRVVWE
ECCCCCCCEEEEEECCCCCCCCCCCCCCHHHHHHHHHHHCCCCHHHHHHHHHHHEEEEEE
LEPNTIPLFDQVQLIGQRKGVKGLTVYSDEIVEFNNATVTR
ECCCCCCHHHHHHHHHHHCCCCEEEEECCCEEEECCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA