Definition Eubacterium rectale ATCC 33656, complete genome.
Accession NC_012781
Length 3,449,685

Click here to switch to the map view.

The map label for this gene is ndvB [H]

Identifier: 238925163

GI number: 238925163

Start: 2694358

End: 2696775

Strand: Reverse

Name: ndvB [H]

Synonym: EUBREC_2817

Alternate gene names: 238925163

Gene position: 2696775-2694358 (Counterclockwise)

Preceding gene: 238925164

Following gene: 238925162

Centisome position: 78.17

GC content: 43.3

Gene sequence:

>2418_bases
ATGAATATGAAATACGGATATTTTGATGAATCAAAAAAAGAATATGTTATTACAAGACCTGACACACCGGCACCATGGGT
AAACTATCTTGGATCGCCGGAGTATGGAGCAATTGTTTCCAATAATGCAGGTGGATACAGCTTTGCAAAGTCAGGTGCAA
ACGGAAGACTTTTGAGATATGTGTTTAATCAGTTCGATGAGCCTGGCAGATATATTTATATCAGAGACAACGACAGCAAG
GATTACTGGTCAGCTTCGTGGCAGCCTGTAGGAAAGGATTTGAATGAATACAAGAGTGAGTGTCATCATGGAACAGCATA
CACAAAGATGATGGCTGATTACAGCGGTATTCATTCAGAAGTAAGATACTACGTTCCGCTGAACAAGACATACGAAGTGT
GGAATTTGAGCGTGACGAATAATTCTGATAAGGCAAGAAGCCTTAATATTACAGGCTACGCTGAGTTTACAAACAACAGC
AACTATGAGCAGGATCAGGTGAATCTGCAGTATTCACAGTATATTACAAAGACAGTATTTGTGGAGAACAGAGTGCGTCA
GATGATCCATGCCAATCTTGACCGCATCGAGGATGGCAAGGAAATTGACAACAAGGATGTGGTAAACAGATTTATCGGAC
TTGCAGGAGCACCTGTTGACAGCTGGTGCGGTGACAGGGGAGAATTTCTCGGAGAATATCACAGATATGGCAATCCTGTC
GGAGTAGAGAGCGGAAAGCTTAACAACCACGGCAACTACAACGAGAATAGCTGTGGAGCAATCACAACAGTATTGGAGCT
GGCACCGGGCGAGACAAAGACAATAGCATTCTTAGTTGGAATGATAGATAATGAGACAGCAGGAAAGATTGTTGCTTCTT
ACACGGATACAAAAGCTGTCTGCGACAAAGAACTTGAGGAGCTTATCGCATACTGGCATGGACAGTTATCACATTTCCAG
ATTAATACACCAAGTGATGAGTTCAACACAATGATCAATACATGGAACGCATATAACTGTTTCATGACATTTATTTGGTC
AAGGGCTGCATCATTTACATACTGTGGACTCAGAAACGGATACGGATACCGTGATACAGTCCAGGATATTCAGGGTGTTA
TACACCTTGCACCAGAGATGGCTGTTGAAAAGATCAGATTCATGCTCTCAGCACAGGTTGATAACGGTGGAGGACTTCCG
CTTGTCAAGTTTACACACAATCCGGGACATGAGGATACTCCTGACGACGCTTCCTATGTACAGGAGACAGGACATCCGGC
TTACAGAGCTGATGATGCATTATGGCTTTTCCCAACTGTATACAAATATGTATCAGAGACAGGAAATGTAGCATTTATAG
ATGAGGTCATTCCATTCGCCAACAAGGATGAGGGAACGGTTTACGAGCATTTAAAGAGAGCAATTGATTTTTCGATGAAC
CACCTCGGAAAACATGGAATGCCTGCAGGACTTTACGCAGACTGGAATGACTGCCTGAGGCTTGGTGCAGATGGAGAGTC
AACCTTCGTAGCACTTCAGTTCTACTATGCAATGACTATATTAAAAGAGTTTGCAGCCTATAAGAAAGATGATGAATATA
TCACATATCTTGATGAGAGCCAGGAAAAACTCGGAAAGGTCATTCAGGAGCTTTGCTGGAACGAGGACAGATTTATCCGT
GGATTTACAGGGGATGGACAGGTTATCGGAAAGCGTGATGATCCTGAGGCAAATATGTGGCTCAACCCACAGAGCTGGGC
TGTTATAAGTGGATTTGCAAGTGATGAGCAGGCTGATAAGGCTCTTGAAATGGTATATGAAAGACTCAATACCGAGTATG
GCGCCATTCTTATGGATCCTCCATATCATGCACACGCATTCGACGGAGCACTCGCAGTGATATACAATGCGGGAACTAAA
GAGAATGCAGGAATATTCTCACAGTCACAGGGCTGGATAATTCTTGCTGAGGCACTTAAAGGACATGGAGACAGAGCTTT
TAAGTATTTTATTGAAAATGCTCCTGCCGCACAGAATGACAGAGCAGAGATAAGAAGACTTGAGCCGTACTGCTATGGAC
AGTTTACTGAAGGAAAAGCAAGTCCAAACTTTGGACGTTCACATGTACACTGGCTCACAGGAACTGCTTCAACAGTCATG
GTTGGATGTGTAGAGGGAATACTTGGTATGCGTCCTGATTTCTATGGACTTCATATTGCTCCGTCTATTCCAAAAGCCTG
GGATGGATTTGAGATAGAGAAGGATTTCAGGGGATGCCATCTTCATATAGTTGTAAAAAATCCTGATCATGTTGAGAGCG
GATGCAAGAGCCTTCTTGTAAACGGACAGGCGGTTGAGGGAGACTATATTCCAAAAGAGCTTCTTAGCGAGCAGACAGAG
ATTGAGCTTACCATGTAA

Upstream 100 bases:

>100_bases
CTGCAAAAATGTATATTATATTACGAAAATGGATCACTGCTGAATATACGTTGGAGGCAGTTATAACCGTAGATCACATA
ATTAAGTAGAGAATGGAGTA

Downstream 100 bases:

>100_bases
ATCTTCCGTAGGTGGGATAATGACTGCTATAGGATTGTATATGGTGTGTGAAAATTTGATTTGTAATTGTATAGAGGATT
GATTGAAAATATGAAAAATA

Product: N,N-diacetylchitobiose phosphorylase

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 805; Mature: 805

Protein sequence:

>805_residues
MNMKYGYFDESKKEYVITRPDTPAPWVNYLGSPEYGAIVSNNAGGYSFAKSGANGRLLRYVFNQFDEPGRYIYIRDNDSK
DYWSASWQPVGKDLNEYKSECHHGTAYTKMMADYSGIHSEVRYYVPLNKTYEVWNLSVTNNSDKARSLNITGYAEFTNNS
NYEQDQVNLQYSQYITKTVFVENRVRQMIHANLDRIEDGKEIDNKDVVNRFIGLAGAPVDSWCGDRGEFLGEYHRYGNPV
GVESGKLNNHGNYNENSCGAITTVLELAPGETKTIAFLVGMIDNETAGKIVASYTDTKAVCDKELEELIAYWHGQLSHFQ
INTPSDEFNTMINTWNAYNCFMTFIWSRAASFTYCGLRNGYGYRDTVQDIQGVIHLAPEMAVEKIRFMLSAQVDNGGGLP
LVKFTHNPGHEDTPDDASYVQETGHPAYRADDALWLFPTVYKYVSETGNVAFIDEVIPFANKDEGTVYEHLKRAIDFSMN
HLGKHGMPAGLYADWNDCLRLGADGESTFVALQFYYAMTILKEFAAYKKDDEYITYLDESQEKLGKVIQELCWNEDRFIR
GFTGDGQVIGKRDDPEANMWLNPQSWAVISGFASDEQADKALEMVYERLNTEYGAILMDPPYHAHAFDGALAVIYNAGTK
ENAGIFSQSQGWIILAEALKGHGDRAFKYFIENAPAAQNDRAEIRRLEPYCYGQFTEGKASPNFGRSHVHWLTGTASTVM
VGCVEGILGMRPDFYGLHIAPSIPKAWDGFEIEKDFRGCHLHIVVKNPDHVESGCKSLLVNGQAVEGDYIPKELLSEQTE
IELTM

Sequences:

>Translated_805_residues
MNMKYGYFDESKKEYVITRPDTPAPWVNYLGSPEYGAIVSNNAGGYSFAKSGANGRLLRYVFNQFDEPGRYIYIRDNDSK
DYWSASWQPVGKDLNEYKSECHHGTAYTKMMADYSGIHSEVRYYVPLNKTYEVWNLSVTNNSDKARSLNITGYAEFTNNS
NYEQDQVNLQYSQYITKTVFVENRVRQMIHANLDRIEDGKEIDNKDVVNRFIGLAGAPVDSWCGDRGEFLGEYHRYGNPV
GVESGKLNNHGNYNENSCGAITTVLELAPGETKTIAFLVGMIDNETAGKIVASYTDTKAVCDKELEELIAYWHGQLSHFQ
INTPSDEFNTMINTWNAYNCFMTFIWSRAASFTYCGLRNGYGYRDTVQDIQGVIHLAPEMAVEKIRFMLSAQVDNGGGLP
LVKFTHNPGHEDTPDDASYVQETGHPAYRADDALWLFPTVYKYVSETGNVAFIDEVIPFANKDEGTVYEHLKRAIDFSMN
HLGKHGMPAGLYADWNDCLRLGADGESTFVALQFYYAMTILKEFAAYKKDDEYITYLDESQEKLGKVIQELCWNEDRFIR
GFTGDGQVIGKRDDPEANMWLNPQSWAVISGFASDEQADKALEMVYERLNTEYGAILMDPPYHAHAFDGALAVIYNAGTK
ENAGIFSQSQGWIILAEALKGHGDRAFKYFIENAPAAQNDRAEIRRLEPYCYGQFTEGKASPNFGRSHVHWLTGTASTVM
VGCVEGILGMRPDFYGLHIAPSIPKAWDGFEIEKDFRGCHLHIVVKNPDHVESGCKSLLVNGQAVEGDYIPKELLSEQTE
IELTM
>Mature_805_residues
MNMKYGYFDESKKEYVITRPDTPAPWVNYLGSPEYGAIVSNNAGGYSFAKSGANGRLLRYVFNQFDEPGRYIYIRDNDSK
DYWSASWQPVGKDLNEYKSECHHGTAYTKMMADYSGIHSEVRYYVPLNKTYEVWNLSVTNNSDKARSLNITGYAEFTNNS
NYEQDQVNLQYSQYITKTVFVENRVRQMIHANLDRIEDGKEIDNKDVVNRFIGLAGAPVDSWCGDRGEFLGEYHRYGNPV
GVESGKLNNHGNYNENSCGAITTVLELAPGETKTIAFLVGMIDNETAGKIVASYTDTKAVCDKELEELIAYWHGQLSHFQ
INTPSDEFNTMINTWNAYNCFMTFIWSRAASFTYCGLRNGYGYRDTVQDIQGVIHLAPEMAVEKIRFMLSAQVDNGGGLP
LVKFTHNPGHEDTPDDASYVQETGHPAYRADDALWLFPTVYKYVSETGNVAFIDEVIPFANKDEGTVYEHLKRAIDFSMN
HLGKHGMPAGLYADWNDCLRLGADGESTFVALQFYYAMTILKEFAAYKKDDEYITYLDESQEKLGKVIQELCWNEDRFIR
GFTGDGQVIGKRDDPEANMWLNPQSWAVISGFASDEQADKALEMVYERLNTEYGAILMDPPYHAHAFDGALAVIYNAGTK
ENAGIFSQSQGWIILAEALKGHGDRAFKYFIENAPAAQNDRAEIRRLEPYCYGQFTEGKASPNFGRSHVHWLTGTASTVM
VGCVEGILGMRPDFYGLHIAPSIPKAWDGFEIEKDFRGCHLHIVVKNPDHVESGCKSLLVNGQAVEGDYIPKELLSEQTE
IELTM

Specific function: Involved in the production of beta-(1,2)-glucan. It is involved not only in invasion but also in bacteroid development [H]

COG id: COG3459

COG function: function code G; Cellobiose phosphorylase

Gene ontology:

Cell location: Cell inner membrane; Multi-pass membrane protein [H]

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: To A.tumefaciens ChvB [H]

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR008928
- InterPro:   IPR009342
- InterPro:   IPR019282
- InterPro:   IPR021478
- InterPro:   IPR011013
- InterPro:   IPR010383
- InterPro:   IPR010403 [H]

Pfam domain/function: PF06204 CBM_X; PF10091 DUF2329; PF11329 DUF3131; PF06165 Glyco_transf_36; PF06205 GT36_AF [H]

EC number: NA

Molecular weight: Translated: 90794; Mature: 90794

Theoretical pI: Translated: 4.78; Mature: 4.78

Prosite motif: PS00092 N6_MTASE

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.5 %Cys     (Translated Protein)
2.4 %Met     (Translated Protein)
3.9 %Cys+Met (Translated Protein)
1.5 %Cys     (Mature Protein)
2.4 %Met     (Mature Protein)
3.9 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MNMKYGYFDESKKEYVITRPDTPAPWVNYLGSPEYGAIVSNNAGGYSFAKSGANGRLLRY
CCCCCCCCCCCCCCEEEECCCCCCHHHHHCCCCCCCEEEECCCCCCHHHCCCCCCHHHHH
VFNQFDEPGRYIYIRDNDSKDYWSASWQPVGKDLNEYKSECHHGTAYTKMMADYSGIHSE
HHHHCCCCCCEEEEEECCCCCCCCCCCCCHHCCHHHHHHHHCCCHHHHHHHHHHHCCCCC
VRYYVPLNKTYEVWNLSVTNNSDKARSLNITGYAEFTNNSNYEQDQVNLQYSQYITKTVF
EEEEEECCCEEEEEEEEEECCCCCCEEEEEEEEEEECCCCCCCHHHCCCHHHHHHHHHHH
VENRVRQMIHANLDRIEDGKEIDNKDVVNRFIGLAGAPVDSWCGDRGEFLGEYHRYGNPV
HHHHHHHHHHHHHHHCCCCCCCCCHHHHHHHHHCCCCCHHHHCCCHHHHHHHHHHCCCCC
GVESGKLNNHGNYNENSCGAITTVLELAPGETKTIAFLVGMIDNETAGKIVASYTDTKAV
CCCCCCCCCCCCCCCCCCHHHHHHHHCCCCCCCEEEEEEEECCCCCCCCEEEECCCHHHH
CDKELEELIAYWHGQLSHFQINTPSDEFNTMINTWNAYNCFMTFIWSRAASFTYCGLRNG
HHHHHHHHHHHHCCCCEEEEECCCCHHHHHHHHCCCHHHHHHHHHHHHHCCEEEEECCCC
YGYRDTVQDIQGVIHLAPEMAVEKIRFMLSAQVDNGGGLPLVKFTHNPGHEDTPDDASYV
CCCHHHHHHHHHHHHHHHHHHHHHHHHHHEEEECCCCCCEEEEEECCCCCCCCCCHHHHH
QETGHPAYRADDALWLFPTVYKYVSETGNVAFIDEVIPFANKDEGTVYEHLKRAIDFSMN
HHCCCCCCCCCCCEEHHHHHHHHHHCCCCEEEEHHHCCCCCCCCCHHHHHHHHHHHHHHH
HLGKHGMPAGLYADWNDCLRLGADGESTFVALQFYYAMTILKEFAAYKKDDEYITYLDES
HCCCCCCCCCCCCCHHHHHEECCCCCCCEEHHHHHHHHHHHHHHHHCCCCCCEEEEECHH
QEKLGKVIQELCWNEDRFIRGFTGDGQVIGKRDDPEANMWLNPQSWAVISGFASDEQADK
HHHHHHHHHHHHCCCCCEEEEECCCCCEECCCCCCCCCEEECCCCCEEEECCCCCHHHHH
ALEMVYERLNTEYGAILMDPPYHAHAFDGALAVIYNAGTKENAGIFSQSQGWIILAEALK
HHHHHHHHHCCCCCEEEECCCCCCCCCCCEEEEEEECCCCCCCCCEECCCCCEEEEHHHC
GHGDRAFKYFIENAPAAQNDRAEIRRLEPYCYGQFTEGKASPNFGRSHVHWLTGTASTVM
CCCCHHHHHHHHCCCCCCCCHHHHHHCCCCEECCCCCCCCCCCCCCCEEEEEECCHHHHH
VGCVEGILGMRPDFYGLHIAPSIPKAWDGFEIEKDFRGCHLHIVVKNPDHVESGCKSLLV
HHHHHHHHCCCCCCEEEEECCCCCCCCCCCEEECCCCCEEEEEEECCCCHHHHHHHHHEE
NGQAVEGDYIPKELLSEQTEIELTM
CCCCCCCCCCCHHHCCCCCEEEEEC
>Mature Secondary Structure
MNMKYGYFDESKKEYVITRPDTPAPWVNYLGSPEYGAIVSNNAGGYSFAKSGANGRLLRY
CCCCCCCCCCCCCCEEEECCCCCCHHHHHCCCCCCCEEEECCCCCCHHHCCCCCCHHHHH
VFNQFDEPGRYIYIRDNDSKDYWSASWQPVGKDLNEYKSECHHGTAYTKMMADYSGIHSE
HHHHCCCCCCEEEEEECCCCCCCCCCCCCHHCCHHHHHHHHCCCHHHHHHHHHHHCCCCC
VRYYVPLNKTYEVWNLSVTNNSDKARSLNITGYAEFTNNSNYEQDQVNLQYSQYITKTVF
EEEEEECCCEEEEEEEEEECCCCCCEEEEEEEEEEECCCCCCCHHHCCCHHHHHHHHHHH
VENRVRQMIHANLDRIEDGKEIDNKDVVNRFIGLAGAPVDSWCGDRGEFLGEYHRYGNPV
HHHHHHHHHHHHHHHCCCCCCCCCHHHHHHHHHCCCCCHHHHCCCHHHHHHHHHHCCCCC
GVESGKLNNHGNYNENSCGAITTVLELAPGETKTIAFLVGMIDNETAGKIVASYTDTKAV
CCCCCCCCCCCCCCCCCCHHHHHHHHCCCCCCCEEEEEEEECCCCCCCCEEEECCCHHHH
CDKELEELIAYWHGQLSHFQINTPSDEFNTMINTWNAYNCFMTFIWSRAASFTYCGLRNG
HHHHHHHHHHHHCCCCEEEEECCCCHHHHHHHHCCCHHHHHHHHHHHHHCCEEEEECCCC
YGYRDTVQDIQGVIHLAPEMAVEKIRFMLSAQVDNGGGLPLVKFTHNPGHEDTPDDASYV
CCCHHHHHHHHHHHHHHHHHHHHHHHHHHEEEECCCCCCEEEEEECCCCCCCCCCHHHHH
QETGHPAYRADDALWLFPTVYKYVSETGNVAFIDEVIPFANKDEGTVYEHLKRAIDFSMN
HHCCCCCCCCCCCEEHHHHHHHHHHCCCCEEEEHHHCCCCCCCCCHHHHHHHHHHHHHHH
HLGKHGMPAGLYADWNDCLRLGADGESTFVALQFYYAMTILKEFAAYKKDDEYITYLDES
HCCCCCCCCCCCCCHHHHHEECCCCCCCEEHHHHHHHHHHHHHHHHCCCCCCEEEEECHH
QEKLGKVIQELCWNEDRFIRGFTGDGQVIGKRDDPEANMWLNPQSWAVISGFASDEQADK
HHHHHHHHHHHHCCCCCEEEEECCCCCEECCCCCCCCCEEECCCCCEEEECCCCCHHHHH
ALEMVYERLNTEYGAILMDPPYHAHAFDGALAVIYNAGTKENAGIFSQSQGWIILAEALK
HHHHHHHHHCCCCCEEEECCCCCCCCCCCEEEEEEECCCCCCCCCEECCCCCEEEEHHHC
GHGDRAFKYFIENAPAAQNDRAEIRRLEPYCYGQFTEGKASPNFGRSHVHWLTGTASTVM
CCCCHHHHHHHHCCCCCCCCHHHHHHCCCCEECCCCCCCCCCCCCCCEEEEEECCHHHHH
VGCVEGILGMRPDFYGLHIAPSIPKAWDGFEIEKDFRGCHLHIVVKNPDHVESGCKSLLV
HHHHHHHHCCCCCCEEEEECCCCCCCCCCCEEECCCCCEEEEEEECCCCHHHHHHHHHEE
NGQAVEGDYIPKELLSEQTEIELTM
CCCCCCCCCCCHHHCCCCCEEEEEC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 2154461; 11481430 [H]