| Definition | Bacteroides thetaiotaomicron VPI-5482 chromosome, complete genome. |
|---|---|
| Accession | NC_004663 |
| Length | 6,260,361 |
Click here to switch to the map view.
The map label for this gene is kpsD [H]
Identifier: 29346766
GI number: 29346766
Start: 1681785
End: 1684154
Strand: Reverse
Name: kpsD [H]
Synonym: BT_1356
Alternate gene names: 29346766
Gene position: 1684154-1681785 (Counterclockwise)
Preceding gene: 29346767
Following gene: 29346765
Centisome position: 26.9
GC content: 48.35
Gene sequence:
>2370_bases ATGCTGGGAAGTGGCTCGCTTATGGCCCAGTCCATGAGTGACTCACAGGTACTGGAATATGTAAAGGACGGCATCCGGCA AGGCAAGGAACAGAAGCAGCTTGCTTCCGAGCTTGCGCGTAAAGGTGTGACCAAGGAACAGGCTATGCGTGTGAAGCAGC TCTATGAGCAGCAGAACAATGTAAACACTTCCCAATCCACGGGTACGGATATCAACGAGTCCCGCCTTCGTGAAGAGACT AAGGAAAATACTTCCGACATGCTGGAAGATCATCCGACTACGGAAGATTTGGCCCGTGAGGACCAGGTTTTCGGGCGCAA CATCTTCAATACCCGCAACCTGACGTTCGAGCCTAGTGTCAACCTTGCCACTCCTGCCAATTACCGTCTGGGCCCCGGTG ATGAAGTCATCATCGATATCTGGGGTGCCAGCCAGAACACGATCCGCCAGCAGATCTCTCCTGAAGGCACCATCAATATT CAGAAGATCGGTCCTGTCAACCTTAGCGGTATGACAGTCTCCGCCGCCAACGACTATCTGAAGAATGCCCTGAATAAGAT CTATAACGGTCTGAACAATACTACCGACCCTACTTCCGACATCCGTCTGACTTTGGGTAATATCCGTACTATCCAGATCA ATGTGATGGGAGAGGTCGTACAGCCGGGTACCTACGCCCTTTCTTCCTTCTCTACCGTCTTCCATGCGCTTTACCGTGCA GGCGGTGTGAGTGATATCGGCAGCCTCCGAAACGTTCAGTTGGTACGCAACGGAAAGAATATCGCCACCATCGACGTTTA TGAATTTATCATGAAAGGCAACACACAGGATGACATCCGCCTTCAGGAAGGTGACGTGGTTATCGTCCCCGCCTACGATG TCTTGGTAAAGATCAGCGGCAAGGTAAAACGCCCTATGCGTTTCGAAATGAAGAAAGACGAGAACCTTGCCACTTTAATC AAATATGCCGGCGGCTTTGAAGCCGATGCCTACACCCGTTCATTGCGTGTTGTCCGTCAGAATGGTGAGGAATATGAGGT CAACACGGTCAAGGATATGGACTACAGCATCTACACAATGCGTAACGGTGACGTTGTAACAGCCGAAGCCATCCTTAACC GCTTCACAAACAAACTGGAAATCCGTGGCGCTGTCTATCGTCCCGGTATCTACCAGCTCAGCGGTAAACTGAATACGATC CGCGAACTTGTCCATGAAGCCCAGGGCCTGACCGGTGACGCTTTTCTGAATCGTGCCGTCCTTTATCGCCAGCGTGAGGA TTTGACCAGTGAAGTTGTTCAGATAGACATCAAGTCTATCATGAACGGTACTTCCCCGAACCTCGCCCTGATGAAGAATG ACATCCTTTACATTCCGAGCATTCACGATCTGGAAGATCGTGGCAATGTCACAGTTCACGGTGAAGTCGCGCATCCCGAT TCCTATCCCTATGCTGATAACATGACACTTGAGGATCTGATCATCCAGGCCGGTGGCTTGAAAGAAGCCGCCTCCACTGT CCGCATTGATGTGTCGAGACGAATCAAGAATCCCCGTAGTACCGCGGATAATGATACGATCGGTCAGATGTATACCTTCT CTTTAAAGGATGGTTTTGTCATCGACGGTCAGCCCGGTTTTATCCTTCAGCCTTATGACGAAGTTTATGTTCGTCGCAGT CCGGGTTATCAGGCGCAACAGAATGTAGTCATTGATGGTGAAATCCTTTTCGGAGGAAATTATGCCATGACCAACCGTGA GGAACGTCTTTCCGATCTGGTGAATAAAGCGGGTGGTCCTACGAGTCTTGCCTATCTTCGTGGTGCGAAATTGACCCGTG TGGCAAGTGCGGGTGAGAAGAAACGTATGGGTGATGTGATTCGCCTGATGAGCAGGCAATTGGGTGAAGCCATGATTGAC TCTTTGGGTATTGGTGTTGAGGATACCTTTACGGTAGGCATTGATCTGGAGAAGGCTTTGACTAATCCTAAGGGTAGTGC CGACCTTGTCCTACGTGAAGGTGATGTGGTCTTTATACCTAAGAATACTAATACTGTAACTATCAATGGTGCTGTCATGG TTCCGAATACGGTTTCTTATATGAAGGGAAAGAATGTGGATTATTACCTGAATCAGGCCGGTGGTTATTCTGATAATGCA AGGAAGAGTAAGAAGTTCATTGTTTACATGAATGGTCAGGTGACGAAGGTTAAGGGAAGTGGTAAGAAACAGATTGAGCC GGGGTGTGAGATTATTGTGCCTAGTAAGGCTAAGAAGAAAGGGAACATAGCTAATATTTTAGGTTATGCTACTTCCTTCA GTTCTTTGGGAATGATGATTGCTTCTATTGCTAATCTTATAAAGAAATAA
Upstream 100 bases:
>100_bases TGCGGTCTGTCATGGTATGCAGGAACTGTGTGAAACCAACTAACTTTTTTATTTGTCAATGAAAATACAACGACTTTTTA GCATTCTACTTTTTTGTTCT
Downstream 100 bases:
>100_bases TAGAATTTACTTTTATGTCAGAACAACGACAGGATAAAAACTTGCTCTCTGAACCACACAAGACAGAAAGTGATGAGATA GAAATTGATTTGGTTGATAT
Product: putative capsule polysaccharide export protein
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 789; Mature: 789
Protein sequence:
>789_residues MLGSGSLMAQSMSDSQVLEYVKDGIRQGKEQKQLASELARKGVTKEQAMRVKQLYEQQNNVNTSQSTGTDINESRLREET KENTSDMLEDHPTTEDLAREDQVFGRNIFNTRNLTFEPSVNLATPANYRLGPGDEVIIDIWGASQNTIRQQISPEGTINI QKIGPVNLSGMTVSAANDYLKNALNKIYNGLNNTTDPTSDIRLTLGNIRTIQINVMGEVVQPGTYALSSFSTVFHALYRA GGVSDIGSLRNVQLVRNGKNIATIDVYEFIMKGNTQDDIRLQEGDVVIVPAYDVLVKISGKVKRPMRFEMKKDENLATLI KYAGGFEADAYTRSLRVVRQNGEEYEVNTVKDMDYSIYTMRNGDVVTAEAILNRFTNKLEIRGAVYRPGIYQLSGKLNTI RELVHEAQGLTGDAFLNRAVLYRQREDLTSEVVQIDIKSIMNGTSPNLALMKNDILYIPSIHDLEDRGNVTVHGEVAHPD SYPYADNMTLEDLIIQAGGLKEAASTVRIDVSRRIKNPRSTADNDTIGQMYTFSLKDGFVIDGQPGFILQPYDEVYVRRS PGYQAQQNVVIDGEILFGGNYAMTNREERLSDLVNKAGGPTSLAYLRGAKLTRVASAGEKKRMGDVIRLMSRQLGEAMID SLGIGVEDTFTVGIDLEKALTNPKGSADLVLREGDVVFIPKNTNTVTINGAVMVPNTVSYMKGKNVDYYLNQAGGYSDNA RKSKKFIVYMNGQVTKVKGSGKKQIEPGCEIIVPSKAKKKGNIANILGYATSFSSLGMMIASIANLIKK
Sequences:
>Translated_789_residues MLGSGSLMAQSMSDSQVLEYVKDGIRQGKEQKQLASELARKGVTKEQAMRVKQLYEQQNNVNTSQSTGTDINESRLREET KENTSDMLEDHPTTEDLAREDQVFGRNIFNTRNLTFEPSVNLATPANYRLGPGDEVIIDIWGASQNTIRQQISPEGTINI QKIGPVNLSGMTVSAANDYLKNALNKIYNGLNNTTDPTSDIRLTLGNIRTIQINVMGEVVQPGTYALSSFSTVFHALYRA GGVSDIGSLRNVQLVRNGKNIATIDVYEFIMKGNTQDDIRLQEGDVVIVPAYDVLVKISGKVKRPMRFEMKKDENLATLI KYAGGFEADAYTRSLRVVRQNGEEYEVNTVKDMDYSIYTMRNGDVVTAEAILNRFTNKLEIRGAVYRPGIYQLSGKLNTI RELVHEAQGLTGDAFLNRAVLYRQREDLTSEVVQIDIKSIMNGTSPNLALMKNDILYIPSIHDLEDRGNVTVHGEVAHPD SYPYADNMTLEDLIIQAGGLKEAASTVRIDVSRRIKNPRSTADNDTIGQMYTFSLKDGFVIDGQPGFILQPYDEVYVRRS PGYQAQQNVVIDGEILFGGNYAMTNREERLSDLVNKAGGPTSLAYLRGAKLTRVASAGEKKRMGDVIRLMSRQLGEAMID SLGIGVEDTFTVGIDLEKALTNPKGSADLVLREGDVVFIPKNTNTVTINGAVMVPNTVSYMKGKNVDYYLNQAGGYSDNA RKSKKFIVYMNGQVTKVKGSGKKQIEPGCEIIVPSKAKKKGNIANILGYATSFSSLGMMIASIANLIKK >Mature_789_residues MLGSGSLMAQSMSDSQVLEYVKDGIRQGKEQKQLASELARKGVTKEQAMRVKQLYEQQNNVNTSQSTGTDINESRLREET KENTSDMLEDHPTTEDLAREDQVFGRNIFNTRNLTFEPSVNLATPANYRLGPGDEVIIDIWGASQNTIRQQISPEGTINI QKIGPVNLSGMTVSAANDYLKNALNKIYNGLNNTTDPTSDIRLTLGNIRTIQINVMGEVVQPGTYALSSFSTVFHALYRA GGVSDIGSLRNVQLVRNGKNIATIDVYEFIMKGNTQDDIRLQEGDVVIVPAYDVLVKISGKVKRPMRFEMKKDENLATLI KYAGGFEADAYTRSLRVVRQNGEEYEVNTVKDMDYSIYTMRNGDVVTAEAILNRFTNKLEIRGAVYRPGIYQLSGKLNTI RELVHEAQGLTGDAFLNRAVLYRQREDLTSEVVQIDIKSIMNGTSPNLALMKNDILYIPSIHDLEDRGNVTVHGEVAHPD SYPYADNMTLEDLIIQAGGLKEAASTVRIDVSRRIKNPRSTADNDTIGQMYTFSLKDGFVIDGQPGFILQPYDEVYVRRS PGYQAQQNVVIDGEILFGGNYAMTNREERLSDLVNKAGGPTSLAYLRGAKLTRVASAGEKKRMGDVIRLMSRQLGEAMID SLGIGVEDTFTVGIDLEKALTNPKGSADLVLREGDVVFIPKNTNTVTINGAVMVPNTVSYMKGKNVDYYLNQAGGYSDNA RKSKKFIVYMNGQVTKVKGSGKKQIEPGCEIIVPSKAKKKGNIANILGYATSFSSLGMMIASIANLIKK
Specific function: Involved in the translocation of the polysialic acid capsule across the outer membrane to the cell surface. May function as the periplasmic binding element of the PSA transport system, in which it transiently interacts with the membrane component of the t
COG id: COG1596
COG function: function code M; Periplasmic protein involved in polysaccharide export
Gene ontology:
Cell location: Periplasm [H]
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: To E.coli K5 kpsD [H]
Homologues:
None
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR003715 [H]
Pfam domain/function: PF02563 Poly_export [H]
EC number: NA
Molecular weight: Translated: 87081; Mature: 87081
Theoretical pI: Translated: 7.68; Mature: 7.68
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.1 %Cys (Translated Protein) 3.2 %Met (Translated Protein) 3.3 %Cys+Met (Translated Protein) 0.1 %Cys (Mature Protein) 3.2 %Met (Mature Protein) 3.3 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MLGSGSLMAQSMSDSQVLEYVKDGIRQGKEQKQLASELARKGVTKEQAMRVKQLYEQQNN CCCCCCHHHHCCCHHHHHHHHHHHHHCCHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHCC VNTSQSTGTDINESRLREETKENTSDMLEDHPTTEDLAREDQVFGRNIFNTRNLTFEPSV CCCCCCCCCCCCHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHCCCCCCCCCEEECCCC NLATPANYRLGPGDEVIIDIWGASQNTIRQQISPEGTINIQKIGPVNLSGMTVSAANDYL CCCCCCCCCCCCCCEEEEEEECCCHHHHHHHCCCCCCEEEEEECCCCCCCEEEHHHHHHH KNALNKIYNGLNNTTDPTSDIRLTLGNIRTIQINVMGEVVQPGTYALSSFSTVFHALYRA HHHHHHHHHCCCCCCCCCCCEEEEECCEEEEEEEEEECCCCCCHHHHHHHHHHHHHHHHC GGVSDIGSLRNVQLVRNGKNIATIDVYEFIMKGNTQDDIRLQEGDVVIVPAYDVLVKISG CCCCHHHCCCCEEEEECCCCEEEEHHHHHHHCCCCCCCCEEECCCEEEEECCEEEEEECC KVKRPMRFEMKKDENLATLIKYAGGFEADAYTRSLRVVRQNGEEYEVNTVKDMDYSIYTM CCCCCEEECCCCCCCHHHHHHHCCCCCHHHHHHHHHHHHCCCCEEEEEEEECCCEEEEEE RNGDVVTAEAILNRFTNKLEIRGAVYRPGIYQLSGKLNTIRELVHEAQGLTGDAFLNRAV CCCCEEEHHHHHHHCCCCEEEEEEEECCCEEEECCCHHHHHHHHHHHCCCCHHHHHHHHH LYRQREDLTSEVVQIDIKSIMNGTSPNLALMKNDILYIPSIHDLEDRGNVTVHGEVAHPD HHHHHHHHHHHHHHHHHHHHHCCCCCCEEEEECCEEEECCCCCCCCCCCEEEEEEECCCC SYPYADNMTLEDLIIQAGGLKEAASTVRIDVSRRIKNPRSTADNDTIGQMYTFSLKDGFV CCCCCCCCCHHHHHHHCCCCHHHHHEEEEEHHHHCCCCCCCCCCCCCCCEEEEEECCCEE IDGQPGFILQPYDEVYVRRSPGYQAQQNVVIDGEILFGGNYAMTNREERLSDLVNKAGGP ECCCCCEEECCHHHEEEECCCCCCCCCCEEEEEEEEECCCEEECCHHHHHHHHHHHCCCC TSLAYLRGAKLTRVASAGEKKRMGDVIRLMSRQLGEAMIDSLGIGVEDTFTVGIDLEKAL CEEHHHCCCCHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCCEEEEEEEHHHHH TNPKGSADLVLREGDVVFIPKNTNTVTINGAVMVPNTVSYMKGKNVDYYLNQAGGYSDNA CCCCCCCEEEEECCCEEEEECCCCEEEEEEEEECCCCHHHHCCCCCEEEEECCCCCCCCC RKSKKFIVYMNGQVTKVKGSGKKQIEPGCEIIVPSKAKKKGNIANILGYATSFSSLGMMI CCCCEEEEEECCEEEEECCCCCCCCCCCCEEEECCCCCCCCCHHHHHHHHHHHHHHHHHH ASIANLIKK HHHHHHHCC >Mature Secondary Structure MLGSGSLMAQSMSDSQVLEYVKDGIRQGKEQKQLASELARKGVTKEQAMRVKQLYEQQNN CCCCCCHHHHCCCHHHHHHHHHHHHHCCHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHCC VNTSQSTGTDINESRLREETKENTSDMLEDHPTTEDLAREDQVFGRNIFNTRNLTFEPSV CCCCCCCCCCCCHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHCCCCCCCCCEEECCCC NLATPANYRLGPGDEVIIDIWGASQNTIRQQISPEGTINIQKIGPVNLSGMTVSAANDYL CCCCCCCCCCCCCCEEEEEEECCCHHHHHHHCCCCCCEEEEEECCCCCCCEEEHHHHHHH KNALNKIYNGLNNTTDPTSDIRLTLGNIRTIQINVMGEVVQPGTYALSSFSTVFHALYRA HHHHHHHHHCCCCCCCCCCCEEEEECCEEEEEEEEEECCCCCCHHHHHHHHHHHHHHHHC GGVSDIGSLRNVQLVRNGKNIATIDVYEFIMKGNTQDDIRLQEGDVVIVPAYDVLVKISG CCCCHHHCCCCEEEEECCCCEEEEHHHHHHHCCCCCCCCEEECCCEEEEECCEEEEEECC KVKRPMRFEMKKDENLATLIKYAGGFEADAYTRSLRVVRQNGEEYEVNTVKDMDYSIYTM CCCCCEEECCCCCCCHHHHHHHCCCCCHHHHHHHHHHHHCCCCEEEEEEEECCCEEEEEE RNGDVVTAEAILNRFTNKLEIRGAVYRPGIYQLSGKLNTIRELVHEAQGLTGDAFLNRAV CCCCEEEHHHHHHHCCCCEEEEEEEECCCEEEECCCHHHHHHHHHHHCCCCHHHHHHHHH LYRQREDLTSEVVQIDIKSIMNGTSPNLALMKNDILYIPSIHDLEDRGNVTVHGEVAHPD HHHHHHHHHHHHHHHHHHHHHCCCCCCEEEEECCEEEECCCCCCCCCCCEEEEEEECCCC SYPYADNMTLEDLIIQAGGLKEAASTVRIDVSRRIKNPRSTADNDTIGQMYTFSLKDGFV CCCCCCCCCHHHHHHHCCCCHHHHHEEEEEHHHHCCCCCCCCCCCCCCCEEEEEECCCEE IDGQPGFILQPYDEVYVRRSPGYQAQQNVVIDGEILFGGNYAMTNREERLSDLVNKAGGP ECCCCCEEECCHHHEEEECCCCCCCCCCEEEEEEEEECCCEEECCHHHHHHHHHHHCCCC TSLAYLRGAKLTRVASAGEKKRMGDVIRLMSRQLGEAMIDSLGIGVEDTFTVGIDLEKAL CEEHHHCCCCHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCCEEEEEEEHHHHH TNPKGSADLVLREGDVVFIPKNTNTVTINGAVMVPNTVSYMKGKNVDYYLNQAGGYSDNA CCCCCCCEEEEECCCEEEEECCCCEEEEEEEEECCCCHHHHCCCCCEEEEECCCCCCCCC RKSKKFIVYMNGQVTKVKGSGKKQIEPGCEIIVPSKAKKKGNIANILGYATSFSSLGMMI CCCCEEEEEECCEEEEECCCCCCCCCCCCEEEECCCCCCCCCHHHHHHHHHHHHHHHHHH ASIANLIKK HHHHHHHCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 8021185 [H]