Definition Bacteroides thetaiotaomicron VPI-5482 chromosome, complete genome.
Accession NC_004663
Length 6,260,361

Click here to switch to the map view.

The map label for this gene is 29349976

Identifier: 29349976

GI number: 29349976

Start: 5988314

End: 5990749

Strand: Reverse

Name: 29349976

Synonym: BT_4568

Alternate gene names: NA

Gene position: 5990749-5988314 (Counterclockwise)

Preceding gene: 29349977

Following gene: 29349975

Centisome position: 95.69

GC content: 39.04

Gene sequence:

>2436_bases
ATGATGAAGACTCTTAAAATCTATTTCCTGCTTATGCTGCTGATTCAGACAATCAGCATATCCGCACAGTCAGTCATATC
GGGTAAAATAACCAATAACGACAGTTCACCCATAGTCGGCGCGACAATATTGTTATCAAACGGTATGGACTCTACCTATA
TAACAGGGACGACCTCCGACTTGGACGGACGATTTAAAATGATAAATGTCAAATCGGGCAATTACTTTCTTTCCTTGTCA
ATGATCGGATATAAGAAAGCAAATATCCCCCTGCAGATCAAGGAAAGCATGAATCTGGAATTGGGTGACATTACACTGGA
AGAAGATTCTTATATATTGTCTACTGTAAATATAATCGGCAAGCGCCCTCCAATCAAGGCCGAACCGGGAAAGATGACAG
TCAACTTATCATCTGCCCTATTGAGTACGGACGGTAATATACTGGATGCACTGAGAAAACTACCGGGAGTAATCGTTCAG
AATGACGGAACAATTATTCTTAATGGCAAATCAGGGGCGAATGTTTTAATGGATGATAAAGTGACCTATTTATCGGGAGA
GAACCTCATCAATTACCTGCGCTCCATCCCTGCCAGTTCTATTGAAAATATAGAACTGATATCCCAGCCATCATCAAAAC
ACGATGCTTCAGGCAGTTCGGGCATCATTAACATTCAAAAAAAGAAAATCAAAGAACAAGGTATAAGCCTTACAGCTTCC
TCCGGTCTGGAACAAGGAAAACATACTAAAGGGAATGAAAACCTGACTCTGAACTTTCACCACAATAAATTGAATATGTA
TGCCGACTATTCTTATTATTGGGGAAAAGATTTTATAGAACTATCGGTTTCCGGTCATTACCTGGATCCGATGACTTTAA
AACCTCTTGAACTGAGAAAAGATTTTGATAGTGATATAAACCGGCAATACAAAGGGCATTATATCAAAACAGGGGTCGAT
TATGACTTGTCGGAGAAGATAGCCATCGGAACATACTTCTCATCAAGCTGGCTCAATAGGAACAAACAAGAAGTGACTGT
ATCTGACTTTTTTAATAACGACAAGACTCAAAGCGACTCAACCTTAACAGCGTTAAGCACACCGGACTATAGCTACACCA
ATATCATAGGGGGAGCGAACATGATATACAAATTTGCGAAAACAGGAAAATGGGATGCTTCTTTTGATTATCAGCTTTTT
AATCAAGAGGATAACCATCTGCTGAAATCCTTTTTTCAGACAGGTATTCATCCGGTAAAAGGAGACACATTGTCCGGTAT
AACCAATGGGGACATTAAAATATACAGCGGACAAACTAATTTGAGCTATGATATCTCTGACAAGTTCGGAATAACCACCG
GGCTCAAATCGGTTTTCGTACATATAAGCAGTGATGCCTTATACAAAAACCTGATTGCCGGTGATTGGAGAGAAGACAGT
GATCTCAGCAGTAGTTTTGCTTATCATGAGAATATCTACGCAGGGTATCTTCAGCTAAACGCTAAATGGTCTGCCAGATT
TTCAACAGAAATAGGCTTACGATTAGAAAGTACATATACAAAAAGCAATTATAATTCAGCCGTTCAGGACTCGGTATTCA
ACCAAAGCTATGTACACCTCTTCCCTACTTTGATGGTTCAATATCAGCTTTCCGAAAATCATAATTTGTCTATGGCATAC
AGCCGTCGCATCGTCCGCCCCAATTACAGAAATATGAATCCTTTCGTTGAGGTCAGAGACCAGTTTTTATATGAACAAGG
AAATACCGAATTAAGACCAGAACTAATAGATAATATAGAAATCTCATGGCTACTCAAAAAACGATATTCATTCAATGTAT
TCTACTCTCACAGGAGTGATCCTATCTCGTTAAGTTTTTTAGTCGAAGATAATAACCGTGTCTTACTAATGCCGCAAAAT
TTATCAGGCAATAACTCATTCGGAGTAAGAGCCGGCTTGAATAACCTAAAACCATTCCAATGGTGGACATCCCATATAAA
CGGATCTTTAACTTATAAGAAATTCAGTTGGGCAACACTTGGGAAAACACTAAAAAATGAAGTGACAACACCCATGCTAC
ATATCAGCAATCAATTTACATTACCATACGGCTGGGATGCGGAAGCCCTCGGATTTTATAGTGGAGAAATGATTGAAGGA
CAGACCAGAGTGAAACCTTTATGGACAATATCTCTCGGAGTCCGCAAAAACCTGTGCAATAACAAATTTAGTTTGTATAT
TTACGCACATGATATATTTCATTCGAACCGCCCCCATGTAAGTATGGAGACTAACTATCTGTATTACGCGTCTCAGGAAA
AAAACGACAGCAGAATGATAGGCATATCGCTCAGTTATCGTTTCAATCGAGGCAAAGAGATTAAGAAATCTCAGAATGAA
AACAGAATAGAAGAAAGTAAACGGATAGGTTTGTAG

Upstream 100 bases:

>100_bases
TTTTCGTTTCATCAAGTAAATCATTCCATTCATCAGATTAATTTGAGTACGCGAAACCATCAGGGTAATTTTGAGGTCAG
AAATCAATTAAACTATTTAA

Downstream 100 bases:

>100_bases
TATCAAAGATTAAAATAGCAACTAATGAACTTAAAGTACGAATGGATTAACACCCTATTTATAATACTGCCACTTTCCTT
GTGCGTATTTATTATTGTAG

Product: hypothetical protein

Products: NA

Alternate protein names: NB-Dependent Receptor Plug; NB-Dependent Outer Membrane Receptor; Nb-Dependent Receptor Plug; Nb-Dependent Receptor; NB Dependent Receptor; NB-Dependent Receptor Domain-Containing Protein; NB Dependent/Ligand-Gated Channel; NB-Dependent Receptor Exported Protein; NB-Dependent Receptor Plug Domain-Containing Protein; Nb-Dependent Outer Membrane Receptor; NB-Dependent Receptor Plug Domain Protein; Outer Membrane Receptor Protein Mostly Fe Transport; Outer Membrane Receptor Family Transporter; Protein Containing nB-Dependent Receptor Plug Domain

Number of amino acids: Translated: 811; Mature: 811

Protein sequence:

>811_residues
MMKTLKIYFLLMLLIQTISISAQSVISGKITNNDSSPIVGATILLSNGMDSTYITGTTSDLDGRFKMINVKSGNYFLSLS
MIGYKKANIPLQIKESMNLELGDITLEEDSYILSTVNIIGKRPPIKAEPGKMTVNLSSALLSTDGNILDALRKLPGVIVQ
NDGTIILNGKSGANVLMDDKVTYLSGENLINYLRSIPASSIENIELISQPSSKHDASGSSGIINIQKKKIKEQGISLTAS
SGLEQGKHTKGNENLTLNFHHNKLNMYADYSYYWGKDFIELSVSGHYLDPMTLKPLELRKDFDSDINRQYKGHYIKTGVD
YDLSEKIAIGTYFSSSWLNRNKQEVTVSDFFNNDKTQSDSTLTALSTPDYSYTNIIGGANMIYKFAKTGKWDASFDYQLF
NQEDNHLLKSFFQTGIHPVKGDTLSGITNGDIKIYSGQTNLSYDISDKFGITTGLKSVFVHISSDALYKNLIAGDWREDS
DLSSSFAYHENIYAGYLQLNAKWSARFSTEIGLRLESTYTKSNYNSAVQDSVFNQSYVHLFPTLMVQYQLSENHNLSMAY
SRRIVRPNYRNMNPFVEVRDQFLYEQGNTELRPELIDNIEISWLLKKRYSFNVFYSHRSDPISLSFLVEDNNRVLLMPQN
LSGNNSFGVRAGLNNLKPFQWWTSHINGSLTYKKFSWATLGKTLKNEVTTPMLHISNQFTLPYGWDAEALGFYSGEMIEG
QTRVKPLWTISLGVRKNLCNNKFSLYIYAHDIFHSNRPHVSMETNYLYYASQEKNDSRMIGISLSYRFNRGKEIKKSQNE
NRIEESKRIGL

Sequences:

>Translated_811_residues
MMKTLKIYFLLMLLIQTISISAQSVISGKITNNDSSPIVGATILLSNGMDSTYITGTTSDLDGRFKMINVKSGNYFLSLS
MIGYKKANIPLQIKESMNLELGDITLEEDSYILSTVNIIGKRPPIKAEPGKMTVNLSSALLSTDGNILDALRKLPGVIVQ
NDGTIILNGKSGANVLMDDKVTYLSGENLINYLRSIPASSIENIELISQPSSKHDASGSSGIINIQKKKIKEQGISLTAS
SGLEQGKHTKGNENLTLNFHHNKLNMYADYSYYWGKDFIELSVSGHYLDPMTLKPLELRKDFDSDINRQYKGHYIKTGVD
YDLSEKIAIGTYFSSSWLNRNKQEVTVSDFFNNDKTQSDSTLTALSTPDYSYTNIIGGANMIYKFAKTGKWDASFDYQLF
NQEDNHLLKSFFQTGIHPVKGDTLSGITNGDIKIYSGQTNLSYDISDKFGITTGLKSVFVHISSDALYKNLIAGDWREDS
DLSSSFAYHENIYAGYLQLNAKWSARFSTEIGLRLESTYTKSNYNSAVQDSVFNQSYVHLFPTLMVQYQLSENHNLSMAY
SRRIVRPNYRNMNPFVEVRDQFLYEQGNTELRPELIDNIEISWLLKKRYSFNVFYSHRSDPISLSFLVEDNNRVLLMPQN
LSGNNSFGVRAGLNNLKPFQWWTSHINGSLTYKKFSWATLGKTLKNEVTTPMLHISNQFTLPYGWDAEALGFYSGEMIEG
QTRVKPLWTISLGVRKNLCNNKFSLYIYAHDIFHSNRPHVSMETNYLYYASQEKNDSRMIGISLSYRFNRGKEIKKSQNE
NRIEESKRIGL
>Mature_811_residues
MMKTLKIYFLLMLLIQTISISAQSVISGKITNNDSSPIVGATILLSNGMDSTYITGTTSDLDGRFKMINVKSGNYFLSLS
MIGYKKANIPLQIKESMNLELGDITLEEDSYILSTVNIIGKRPPIKAEPGKMTVNLSSALLSTDGNILDALRKLPGVIVQ
NDGTIILNGKSGANVLMDDKVTYLSGENLINYLRSIPASSIENIELISQPSSKHDASGSSGIINIQKKKIKEQGISLTAS
SGLEQGKHTKGNENLTLNFHHNKLNMYADYSYYWGKDFIELSVSGHYLDPMTLKPLELRKDFDSDINRQYKGHYIKTGVD
YDLSEKIAIGTYFSSSWLNRNKQEVTVSDFFNNDKTQSDSTLTALSTPDYSYTNIIGGANMIYKFAKTGKWDASFDYQLF
NQEDNHLLKSFFQTGIHPVKGDTLSGITNGDIKIYSGQTNLSYDISDKFGITTGLKSVFVHISSDALYKNLIAGDWREDS
DLSSSFAYHENIYAGYLQLNAKWSARFSTEIGLRLESTYTKSNYNSAVQDSVFNQSYVHLFPTLMVQYQLSENHNLSMAY
SRRIVRPNYRNMNPFVEVRDQFLYEQGNTELRPELIDNIEISWLLKKRYSFNVFYSHRSDPISLSFLVEDNNRVLLMPQN
LSGNNSFGVRAGLNNLKPFQWWTSHINGSLTYKKFSWATLGKTLKNEVTTPMLHISNQFTLPYGWDAEALGFYSGEMIEG
QTRVKPLWTISLGVRKNLCNNKFSLYIYAHDIFHSNRPHVSMETNYLYYASQEKNDSRMIGISLSYRFNRGKEIKKSQNE
NRIEESKRIGL

Specific function: Unknown

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 91853; Mature: 91853

Theoretical pI: Translated: 8.82; Mature: 8.82

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.1 %Cys     (Translated Protein)
2.5 %Met     (Translated Protein)
2.6 %Cys+Met (Translated Protein)
0.1 %Cys     (Mature Protein)
2.5 %Met     (Mature Protein)
2.6 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MMKTLKIYFLLMLLIQTISISAQSVISGKITNNDSSPIVGATILLSNGMDSTYITGTTSD
CCCHHHHHHHHHHHHHHHCCCCHHEEEEEEECCCCCCEEEEEEEEECCCCCEEEEECCCC
LDGRFKMINVKSGNYFLSLSMIGYKKANIPLQIKESMNLELGDITLEEDSYILSTVNIIG
CCCEEEEEEEECCCEEEEEEEEEEEECCCCEEECCCCCEEEEEEEECCCCEEEEEEHHHC
KRPPIKAEPGKMTVNLSSALLSTDGNILDALRKLPGVIVQNDGTIILNGKSGANVLMDDK
CCCCCCCCCCEEEEEECHHEECCCCHHHHHHHHCCCEEEECCCEEEEECCCCCCEEEECC
VTYLSGENLINYLRSIPASSIENIELISQPSSKHDASGSSGIINIQKKKIKEQGISLTAS
EEEECCHHHHHHHHHCCCCCCCCEEEECCCCCCCCCCCCCCEEEEHHHHHHHCCCEEEEC
SGLEQGKHTKGNENLTLNFHHNKLNMYADYSYYWGKDFIELSVSGHYLDPMTLKPLELRK
CCCCCCCCCCCCCEEEEEEECCEEEEEEECEEECCCEEEEEEECCEEECCCCCCHHHHHH
DFDSDINRQYKGHYIKTGVDYDLSEKIAIGTYFSSSWLNRNKQEVTVSDFFNNDKTQSDS
HCCHHHCCCCCCEEEEECCCCCCCCCEEEEEEECHHHHCCCCCEEEEEHHCCCCCCCCCC
TLTALSTPDYSYTNIIGGANMIYKFAKTGKWDASFDYQLFNQEDNHLLKSFFQTGIHPVK
EEEEECCCCCCHHEECCCHHHHHHHHCCCCCCCCCCEEEECCCCHHHHHHHHHHCCCCCC
GDTLSGITNGDIKIYSGQTNLSYDISDKFGITTGLKSVFVHISSDALYKNLIAGDWREDS
CCCCCCCCCCCEEEEECCCCEEEECCCCCCCHHCCEEEEEEECCCHHHHHHHCCCCCCCC
DLSSSFAYHENIYAGYLQLNAKWSARFSTEIGLRLESTYTKSNYNSAVQDSVFNQSYVHL
CCCCCCEECCCEEEEEEEEEEEECEEEEEEECEEEEEEECCCCCCCHHHHHHCCCHHHHE
FPTLMVQYQLSENHNLSMAYSRRIVRPNYRNMNPFVEVRDQFLYEQGNTELRPELIDNIE
EEEEEEEEEECCCCCEEEHHHCEECCCCCCCCCHHHHHHHHHHHHCCCCCCCHHHHCCCE
ISWLLKKRYSFNVFYSHRSDPISLSFLVEDNNRVLLMPQNLSGNNSFGVRAGLNNLKPFQ
EEEEEEECEEEEEEEECCCCCEEEEEEEECCCEEEEEECCCCCCCCCEEECCCCCCCCHH
WWTSHINGSLTYKKFSWATLGKTLKNEVTTPMLHISNQFTLPYGWDAEALGFYSGEMIEG
HHHHHCCCEEEEEEEEHHHHHHHHHHHCCCCEEEECCEEECCCCCCCHHCEEECCCEECC
QTRVKPLWTISLGVRKNLCNNKFSLYIYAHDIFHSNRPHVSMETNYLYYASQEKNDSRMI
CCCCCEEEEEEECHHHHHCCCCEEEEEEEEEHHCCCCCEEEEECCEEEEEECCCCCCEEE
GISLSYRFNRGKEIKKSQNENRIEESKRIGL
EEEEEEEECCCCHHHHCCCHHHHHHHHCCCC
>Mature Secondary Structure
MMKTLKIYFLLMLLIQTISISAQSVISGKITNNDSSPIVGATILLSNGMDSTYITGTTSD
CCCHHHHHHHHHHHHHHHCCCCHHEEEEEEECCCCCCEEEEEEEEECCCCCEEEEECCCC
LDGRFKMINVKSGNYFLSLSMIGYKKANIPLQIKESMNLELGDITLEEDSYILSTVNIIG
CCCEEEEEEEECCCEEEEEEEEEEEECCCCEEECCCCCEEEEEEEECCCCEEEEEEHHHC
KRPPIKAEPGKMTVNLSSALLSTDGNILDALRKLPGVIVQNDGTIILNGKSGANVLMDDK
CCCCCCCCCCEEEEEECHHEECCCCHHHHHHHHCCCEEEECCCEEEEECCCCCCEEEECC
VTYLSGENLINYLRSIPASSIENIELISQPSSKHDASGSSGIINIQKKKIKEQGISLTAS
EEEECCHHHHHHHHHCCCCCCCCEEEECCCCCCCCCCCCCCEEEEHHHHHHHCCCEEEEC
SGLEQGKHTKGNENLTLNFHHNKLNMYADYSYYWGKDFIELSVSGHYLDPMTLKPLELRK
CCCCCCCCCCCCCEEEEEEECCEEEEEEECEEECCCEEEEEEECCEEECCCCCCHHHHHH
DFDSDINRQYKGHYIKTGVDYDLSEKIAIGTYFSSSWLNRNKQEVTVSDFFNNDKTQSDS
HCCHHHCCCCCCEEEEECCCCCCCCCEEEEEEECHHHHCCCCCEEEEEHHCCCCCCCCCC
TLTALSTPDYSYTNIIGGANMIYKFAKTGKWDASFDYQLFNQEDNHLLKSFFQTGIHPVK
EEEEECCCCCCHHEECCCHHHHHHHHCCCCCCCCCCEEEECCCCHHHHHHHHHHCCCCCC
GDTLSGITNGDIKIYSGQTNLSYDISDKFGITTGLKSVFVHISSDALYKNLIAGDWREDS
CCCCCCCCCCCEEEEECCCCEEEECCCCCCCHHCCEEEEEEECCCHHHHHHHCCCCCCCC
DLSSSFAYHENIYAGYLQLNAKWSARFSTEIGLRLESTYTKSNYNSAVQDSVFNQSYVHL
CCCCCCEECCCEEEEEEEEEEEECEEEEEEECEEEEEEECCCCCCCHHHHHHCCCHHHHE
FPTLMVQYQLSENHNLSMAYSRRIVRPNYRNMNPFVEVRDQFLYEQGNTELRPELIDNIE
EEEEEEEEEECCCCCEEEHHHCEECCCCCCCCCHHHHHHHHHHHHCCCCCCCHHHHCCCE
ISWLLKKRYSFNVFYSHRSDPISLSFLVEDNNRVLLMPQNLSGNNSFGVRAGLNNLKPFQ
EEEEEEECEEEEEEEECCCCCEEEEEEEECCCEEEEEECCCCCCCCCEEECCCCCCCCHH
WWTSHINGSLTYKKFSWATLGKTLKNEVTTPMLHISNQFTLPYGWDAEALGFYSGEMIEG
HHHHHCCCEEEEEEEEHHHHHHHHHHHCCCCEEEECCEEECCCCCCCHHCEEECCCEECC
QTRVKPLWTISLGVRKNLCNNKFSLYIYAHDIFHSNRPHVSMETNYLYYASQEKNDSRMI
CCCCCEEEEEEECHHHHHCCCCEEEEEEEEEHHCCCCCEEEEECCEEEEEECCCCCCEEE
GISLSYRFNRGKEIKKSQNENRIEESKRIGL
EEEEEEEECCCCHHHHCCCHHHHHHHHCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA