The gene/protein map for NC_007520 is currently unavailable.
Definition Bacteroides thetaiotaomicron VPI-5482 chromosome, complete genome.
Accession NC_004663
Length 6,260,361

Click here to switch to the map view.

The map label for this gene is kpsD [H]

Identifier: 29346766

GI number: 29346766

Start: 1681785

End: 1684154

Strand: Reverse

Name: kpsD [H]

Synonym: BT_1356

Alternate gene names: 29346766

Gene position: 1684154-1681785 (Counterclockwise)

Preceding gene: 29346767

Following gene: 29346765

Centisome position: 26.9

GC content: 48.35

Gene sequence:

>2370_bases
ATGCTGGGAAGTGGCTCGCTTATGGCCCAGTCCATGAGTGACTCACAGGTACTGGAATATGTAAAGGACGGCATCCGGCA
AGGCAAGGAACAGAAGCAGCTTGCTTCCGAGCTTGCGCGTAAAGGTGTGACCAAGGAACAGGCTATGCGTGTGAAGCAGC
TCTATGAGCAGCAGAACAATGTAAACACTTCCCAATCCACGGGTACGGATATCAACGAGTCCCGCCTTCGTGAAGAGACT
AAGGAAAATACTTCCGACATGCTGGAAGATCATCCGACTACGGAAGATTTGGCCCGTGAGGACCAGGTTTTCGGGCGCAA
CATCTTCAATACCCGCAACCTGACGTTCGAGCCTAGTGTCAACCTTGCCACTCCTGCCAATTACCGTCTGGGCCCCGGTG
ATGAAGTCATCATCGATATCTGGGGTGCCAGCCAGAACACGATCCGCCAGCAGATCTCTCCTGAAGGCACCATCAATATT
CAGAAGATCGGTCCTGTCAACCTTAGCGGTATGACAGTCTCCGCCGCCAACGACTATCTGAAGAATGCCCTGAATAAGAT
CTATAACGGTCTGAACAATACTACCGACCCTACTTCCGACATCCGTCTGACTTTGGGTAATATCCGTACTATCCAGATCA
ATGTGATGGGAGAGGTCGTACAGCCGGGTACCTACGCCCTTTCTTCCTTCTCTACCGTCTTCCATGCGCTTTACCGTGCA
GGCGGTGTGAGTGATATCGGCAGCCTCCGAAACGTTCAGTTGGTACGCAACGGAAAGAATATCGCCACCATCGACGTTTA
TGAATTTATCATGAAAGGCAACACACAGGATGACATCCGCCTTCAGGAAGGTGACGTGGTTATCGTCCCCGCCTACGATG
TCTTGGTAAAGATCAGCGGCAAGGTAAAACGCCCTATGCGTTTCGAAATGAAGAAAGACGAGAACCTTGCCACTTTAATC
AAATATGCCGGCGGCTTTGAAGCCGATGCCTACACCCGTTCATTGCGTGTTGTCCGTCAGAATGGTGAGGAATATGAGGT
CAACACGGTCAAGGATATGGACTACAGCATCTACACAATGCGTAACGGTGACGTTGTAACAGCCGAAGCCATCCTTAACC
GCTTCACAAACAAACTGGAAATCCGTGGCGCTGTCTATCGTCCCGGTATCTACCAGCTCAGCGGTAAACTGAATACGATC
CGCGAACTTGTCCATGAAGCCCAGGGCCTGACCGGTGACGCTTTTCTGAATCGTGCCGTCCTTTATCGCCAGCGTGAGGA
TTTGACCAGTGAAGTTGTTCAGATAGACATCAAGTCTATCATGAACGGTACTTCCCCGAACCTCGCCCTGATGAAGAATG
ACATCCTTTACATTCCGAGCATTCACGATCTGGAAGATCGTGGCAATGTCACAGTTCACGGTGAAGTCGCGCATCCCGAT
TCCTATCCCTATGCTGATAACATGACACTTGAGGATCTGATCATCCAGGCCGGTGGCTTGAAAGAAGCCGCCTCCACTGT
CCGCATTGATGTGTCGAGACGAATCAAGAATCCCCGTAGTACCGCGGATAATGATACGATCGGTCAGATGTATACCTTCT
CTTTAAAGGATGGTTTTGTCATCGACGGTCAGCCCGGTTTTATCCTTCAGCCTTATGACGAAGTTTATGTTCGTCGCAGT
CCGGGTTATCAGGCGCAACAGAATGTAGTCATTGATGGTGAAATCCTTTTCGGAGGAAATTATGCCATGACCAACCGTGA
GGAACGTCTTTCCGATCTGGTGAATAAAGCGGGTGGTCCTACGAGTCTTGCCTATCTTCGTGGTGCGAAATTGACCCGTG
TGGCAAGTGCGGGTGAGAAGAAACGTATGGGTGATGTGATTCGCCTGATGAGCAGGCAATTGGGTGAAGCCATGATTGAC
TCTTTGGGTATTGGTGTTGAGGATACCTTTACGGTAGGCATTGATCTGGAGAAGGCTTTGACTAATCCTAAGGGTAGTGC
CGACCTTGTCCTACGTGAAGGTGATGTGGTCTTTATACCTAAGAATACTAATACTGTAACTATCAATGGTGCTGTCATGG
TTCCGAATACGGTTTCTTATATGAAGGGAAAGAATGTGGATTATTACCTGAATCAGGCCGGTGGTTATTCTGATAATGCA
AGGAAGAGTAAGAAGTTCATTGTTTACATGAATGGTCAGGTGACGAAGGTTAAGGGAAGTGGTAAGAAACAGATTGAGCC
GGGGTGTGAGATTATTGTGCCTAGTAAGGCTAAGAAGAAAGGGAACATAGCTAATATTTTAGGTTATGCTACTTCCTTCA
GTTCTTTGGGAATGATGATTGCTTCTATTGCTAATCTTATAAAGAAATAA

Upstream 100 bases:

>100_bases
TGCGGTCTGTCATGGTATGCAGGAACTGTGTGAAACCAACTAACTTTTTTATTTGTCAATGAAAATACAACGACTTTTTA
GCATTCTACTTTTTTGTTCT

Downstream 100 bases:

>100_bases
TAGAATTTACTTTTATGTCAGAACAACGACAGGATAAAAACTTGCTCTCTGAACCACACAAGACAGAAAGTGATGAGATA
GAAATTGATTTGGTTGATAT

Product: putative capsule polysaccharide export protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 789; Mature: 789

Protein sequence:

>789_residues
MLGSGSLMAQSMSDSQVLEYVKDGIRQGKEQKQLASELARKGVTKEQAMRVKQLYEQQNNVNTSQSTGTDINESRLREET
KENTSDMLEDHPTTEDLAREDQVFGRNIFNTRNLTFEPSVNLATPANYRLGPGDEVIIDIWGASQNTIRQQISPEGTINI
QKIGPVNLSGMTVSAANDYLKNALNKIYNGLNNTTDPTSDIRLTLGNIRTIQINVMGEVVQPGTYALSSFSTVFHALYRA
GGVSDIGSLRNVQLVRNGKNIATIDVYEFIMKGNTQDDIRLQEGDVVIVPAYDVLVKISGKVKRPMRFEMKKDENLATLI
KYAGGFEADAYTRSLRVVRQNGEEYEVNTVKDMDYSIYTMRNGDVVTAEAILNRFTNKLEIRGAVYRPGIYQLSGKLNTI
RELVHEAQGLTGDAFLNRAVLYRQREDLTSEVVQIDIKSIMNGTSPNLALMKNDILYIPSIHDLEDRGNVTVHGEVAHPD
SYPYADNMTLEDLIIQAGGLKEAASTVRIDVSRRIKNPRSTADNDTIGQMYTFSLKDGFVIDGQPGFILQPYDEVYVRRS
PGYQAQQNVVIDGEILFGGNYAMTNREERLSDLVNKAGGPTSLAYLRGAKLTRVASAGEKKRMGDVIRLMSRQLGEAMID
SLGIGVEDTFTVGIDLEKALTNPKGSADLVLREGDVVFIPKNTNTVTINGAVMVPNTVSYMKGKNVDYYLNQAGGYSDNA
RKSKKFIVYMNGQVTKVKGSGKKQIEPGCEIIVPSKAKKKGNIANILGYATSFSSLGMMIASIANLIKK

Sequences:

>Translated_789_residues
MLGSGSLMAQSMSDSQVLEYVKDGIRQGKEQKQLASELARKGVTKEQAMRVKQLYEQQNNVNTSQSTGTDINESRLREET
KENTSDMLEDHPTTEDLAREDQVFGRNIFNTRNLTFEPSVNLATPANYRLGPGDEVIIDIWGASQNTIRQQISPEGTINI
QKIGPVNLSGMTVSAANDYLKNALNKIYNGLNNTTDPTSDIRLTLGNIRTIQINVMGEVVQPGTYALSSFSTVFHALYRA
GGVSDIGSLRNVQLVRNGKNIATIDVYEFIMKGNTQDDIRLQEGDVVIVPAYDVLVKISGKVKRPMRFEMKKDENLATLI
KYAGGFEADAYTRSLRVVRQNGEEYEVNTVKDMDYSIYTMRNGDVVTAEAILNRFTNKLEIRGAVYRPGIYQLSGKLNTI
RELVHEAQGLTGDAFLNRAVLYRQREDLTSEVVQIDIKSIMNGTSPNLALMKNDILYIPSIHDLEDRGNVTVHGEVAHPD
SYPYADNMTLEDLIIQAGGLKEAASTVRIDVSRRIKNPRSTADNDTIGQMYTFSLKDGFVIDGQPGFILQPYDEVYVRRS
PGYQAQQNVVIDGEILFGGNYAMTNREERLSDLVNKAGGPTSLAYLRGAKLTRVASAGEKKRMGDVIRLMSRQLGEAMID
SLGIGVEDTFTVGIDLEKALTNPKGSADLVLREGDVVFIPKNTNTVTINGAVMVPNTVSYMKGKNVDYYLNQAGGYSDNA
RKSKKFIVYMNGQVTKVKGSGKKQIEPGCEIIVPSKAKKKGNIANILGYATSFSSLGMMIASIANLIKK
>Mature_789_residues
MLGSGSLMAQSMSDSQVLEYVKDGIRQGKEQKQLASELARKGVTKEQAMRVKQLYEQQNNVNTSQSTGTDINESRLREET
KENTSDMLEDHPTTEDLAREDQVFGRNIFNTRNLTFEPSVNLATPANYRLGPGDEVIIDIWGASQNTIRQQISPEGTINI
QKIGPVNLSGMTVSAANDYLKNALNKIYNGLNNTTDPTSDIRLTLGNIRTIQINVMGEVVQPGTYALSSFSTVFHALYRA
GGVSDIGSLRNVQLVRNGKNIATIDVYEFIMKGNTQDDIRLQEGDVVIVPAYDVLVKISGKVKRPMRFEMKKDENLATLI
KYAGGFEADAYTRSLRVVRQNGEEYEVNTVKDMDYSIYTMRNGDVVTAEAILNRFTNKLEIRGAVYRPGIYQLSGKLNTI
RELVHEAQGLTGDAFLNRAVLYRQREDLTSEVVQIDIKSIMNGTSPNLALMKNDILYIPSIHDLEDRGNVTVHGEVAHPD
SYPYADNMTLEDLIIQAGGLKEAASTVRIDVSRRIKNPRSTADNDTIGQMYTFSLKDGFVIDGQPGFILQPYDEVYVRRS
PGYQAQQNVVIDGEILFGGNYAMTNREERLSDLVNKAGGPTSLAYLRGAKLTRVASAGEKKRMGDVIRLMSRQLGEAMID
SLGIGVEDTFTVGIDLEKALTNPKGSADLVLREGDVVFIPKNTNTVTINGAVMVPNTVSYMKGKNVDYYLNQAGGYSDNA
RKSKKFIVYMNGQVTKVKGSGKKQIEPGCEIIVPSKAKKKGNIANILGYATSFSSLGMMIASIANLIKK

Specific function: Involved in the translocation of the polysialic acid capsule across the outer membrane to the cell surface. May function as the periplasmic binding element of the PSA transport system, in which it transiently interacts with the membrane component of the t

COG id: COG1596

COG function: function code M; Periplasmic protein involved in polysaccharide export

Gene ontology:

Cell location: Periplasm [H]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: To E.coli K5 kpsD [H]

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR003715 [H]

Pfam domain/function: PF02563 Poly_export [H]

EC number: NA

Molecular weight: Translated: 87081; Mature: 87081

Theoretical pI: Translated: 7.68; Mature: 7.68

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.1 %Cys     (Translated Protein)
3.2 %Met     (Translated Protein)
3.3 %Cys+Met (Translated Protein)
0.1 %Cys     (Mature Protein)
3.2 %Met     (Mature Protein)
3.3 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MLGSGSLMAQSMSDSQVLEYVKDGIRQGKEQKQLASELARKGVTKEQAMRVKQLYEQQNN
CCCCCCHHHHCCCHHHHHHHHHHHHHCCHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHCC
VNTSQSTGTDINESRLREETKENTSDMLEDHPTTEDLAREDQVFGRNIFNTRNLTFEPSV
CCCCCCCCCCCCHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHCCCCCCCCCEEECCCC
NLATPANYRLGPGDEVIIDIWGASQNTIRQQISPEGTINIQKIGPVNLSGMTVSAANDYL
CCCCCCCCCCCCCCEEEEEEECCCHHHHHHHCCCCCCEEEEEECCCCCCCEEEHHHHHHH
KNALNKIYNGLNNTTDPTSDIRLTLGNIRTIQINVMGEVVQPGTYALSSFSTVFHALYRA
HHHHHHHHHCCCCCCCCCCCEEEEECCEEEEEEEEEECCCCCCHHHHHHHHHHHHHHHHC
GGVSDIGSLRNVQLVRNGKNIATIDVYEFIMKGNTQDDIRLQEGDVVIVPAYDVLVKISG
CCCCHHHCCCCEEEEECCCCEEEEHHHHHHHCCCCCCCCEEECCCEEEEECCEEEEEECC
KVKRPMRFEMKKDENLATLIKYAGGFEADAYTRSLRVVRQNGEEYEVNTVKDMDYSIYTM
CCCCCEEECCCCCCCHHHHHHHCCCCCHHHHHHHHHHHHCCCCEEEEEEEECCCEEEEEE
RNGDVVTAEAILNRFTNKLEIRGAVYRPGIYQLSGKLNTIRELVHEAQGLTGDAFLNRAV
CCCCEEEHHHHHHHCCCCEEEEEEEECCCEEEECCCHHHHHHHHHHHCCCCHHHHHHHHH
LYRQREDLTSEVVQIDIKSIMNGTSPNLALMKNDILYIPSIHDLEDRGNVTVHGEVAHPD
HHHHHHHHHHHHHHHHHHHHHCCCCCCEEEEECCEEEECCCCCCCCCCCEEEEEEECCCC
SYPYADNMTLEDLIIQAGGLKEAASTVRIDVSRRIKNPRSTADNDTIGQMYTFSLKDGFV
CCCCCCCCCHHHHHHHCCCCHHHHHEEEEEHHHHCCCCCCCCCCCCCCCEEEEEECCCEE
IDGQPGFILQPYDEVYVRRSPGYQAQQNVVIDGEILFGGNYAMTNREERLSDLVNKAGGP
ECCCCCEEECCHHHEEEECCCCCCCCCCEEEEEEEEECCCEEECCHHHHHHHHHHHCCCC
TSLAYLRGAKLTRVASAGEKKRMGDVIRLMSRQLGEAMIDSLGIGVEDTFTVGIDLEKAL
CEEHHHCCCCHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCCEEEEEEEHHHHH
TNPKGSADLVLREGDVVFIPKNTNTVTINGAVMVPNTVSYMKGKNVDYYLNQAGGYSDNA
CCCCCCCEEEEECCCEEEEECCCCEEEEEEEEECCCCHHHHCCCCCEEEEECCCCCCCCC
RKSKKFIVYMNGQVTKVKGSGKKQIEPGCEIIVPSKAKKKGNIANILGYATSFSSLGMMI
CCCCEEEEEECCEEEEECCCCCCCCCCCCEEEECCCCCCCCCHHHHHHHHHHHHHHHHHH
ASIANLIKK
HHHHHHHCC
>Mature Secondary Structure
MLGSGSLMAQSMSDSQVLEYVKDGIRQGKEQKQLASELARKGVTKEQAMRVKQLYEQQNN
CCCCCCHHHHCCCHHHHHHHHHHHHHCCHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHCC
VNTSQSTGTDINESRLREETKENTSDMLEDHPTTEDLAREDQVFGRNIFNTRNLTFEPSV
CCCCCCCCCCCCHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHCCCCCCCCCEEECCCC
NLATPANYRLGPGDEVIIDIWGASQNTIRQQISPEGTINIQKIGPVNLSGMTVSAANDYL
CCCCCCCCCCCCCCEEEEEEECCCHHHHHHHCCCCCCEEEEEECCCCCCCEEEHHHHHHH
KNALNKIYNGLNNTTDPTSDIRLTLGNIRTIQINVMGEVVQPGTYALSSFSTVFHALYRA
HHHHHHHHHCCCCCCCCCCCEEEEECCEEEEEEEEEECCCCCCHHHHHHHHHHHHHHHHC
GGVSDIGSLRNVQLVRNGKNIATIDVYEFIMKGNTQDDIRLQEGDVVIVPAYDVLVKISG
CCCCHHHCCCCEEEEECCCCEEEEHHHHHHHCCCCCCCCEEECCCEEEEECCEEEEEECC
KVKRPMRFEMKKDENLATLIKYAGGFEADAYTRSLRVVRQNGEEYEVNTVKDMDYSIYTM
CCCCCEEECCCCCCCHHHHHHHCCCCCHHHHHHHHHHHHCCCCEEEEEEEECCCEEEEEE
RNGDVVTAEAILNRFTNKLEIRGAVYRPGIYQLSGKLNTIRELVHEAQGLTGDAFLNRAV
CCCCEEEHHHHHHHCCCCEEEEEEEECCCEEEECCCHHHHHHHHHHHCCCCHHHHHHHHH
LYRQREDLTSEVVQIDIKSIMNGTSPNLALMKNDILYIPSIHDLEDRGNVTVHGEVAHPD
HHHHHHHHHHHHHHHHHHHHHCCCCCCEEEEECCEEEECCCCCCCCCCCEEEEEEECCCC
SYPYADNMTLEDLIIQAGGLKEAASTVRIDVSRRIKNPRSTADNDTIGQMYTFSLKDGFV
CCCCCCCCCHHHHHHHCCCCHHHHHEEEEEHHHHCCCCCCCCCCCCCCCEEEEEECCCEE
IDGQPGFILQPYDEVYVRRSPGYQAQQNVVIDGEILFGGNYAMTNREERLSDLVNKAGGP
ECCCCCEEECCHHHEEEECCCCCCCCCCEEEEEEEEECCCEEECCHHHHHHHHHHHCCCC
TSLAYLRGAKLTRVASAGEKKRMGDVIRLMSRQLGEAMIDSLGIGVEDTFTVGIDLEKAL
CEEHHHCCCCHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCCEEEEEEEHHHHH
TNPKGSADLVLREGDVVFIPKNTNTVTINGAVMVPNTVSYMKGKNVDYYLNQAGGYSDNA
CCCCCCCEEEEECCCEEEEECCCCEEEEEEEEECCCCHHHHCCCCCEEEEECCCCCCCCC
RKSKKFIVYMNGQVTKVKGSGKKQIEPGCEIIVPSKAKKKGNIANILGYATSFSSLGMMI
CCCCEEEEEECCEEEEECCCCCCCCCCCCEEEECCCCCCCCCHHHHHHHHHHHHHHHHHH
ASIANLIKK
HHHHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 8021185 [H]