The gene/protein map for NC_012781 is currently unavailable.
Definition Eubacterium rectale ATCC 33656, complete genome.
Accession NC_012781
Length 3,449,685

Click here to switch to the map view.

The map label for this gene is 238923420

Identifier: 238923420

GI number: 238923420

Start: 936351

End: 937493

Strand: Direct

Name: 238923420

Synonym: EUBREC_1040

Alternate gene names: NA

Gene position: 936351-937493 (Clockwise)

Preceding gene: 238923419

Following gene: 238923421

Centisome position: 27.14

GC content: 42.96

Gene sequence:

>1143_bases
ATGGCAGGAGCATATAAGACAGGCAAATACAGAAATATATTCAAAGAGTATGGGTATCCGGAAGAAGAAATTCAAAAAAG
AGTAGAGGATACTTTTAACACGATATTCTATGGGAATGATGATGAACGTTTTTATCATGAAGCCGGTGATGATATGGGAT
ATATGGAGGATACCGGCAATCATGATGTGAGAACCGAGGGAATGTCATATGGCATGATGGTATGTGTACAGCTGGACAAA
AAAGCAGAGTTTGACAGACTGTGGAAATGGGTGCGCACATATATGTATATAGAAGATGGTCCGGCAAAAAATTATTTTGC
GTGGTCATGTCAGACAAACGGAAAGCGAAATGCCGATGGACCGGCACCTGATGGTGAAGAGTATTTTGCAATGGCATTAT
TTTTCGCCTCTAAAAGATGGGGAGATGGCGATGGTATATTCTGCTACAGCAAAGAGGCACAAAATATCTTAAGGGAGTGT
GTACACAAGGGTGAGCCGGGACACAGCGGAGAGCCAATGTGGGAGCCTTCCAACAAGCTGATAAAGTTTGTCACAAATAT
GGATTTCAGTGATCCTTCATACCATCTGCCGCATTTTTATGAACTTTTTGCCCAAAGGGCTTATGAGGAGGACCGAGACT
TCTGGAAAGAAGCAGCAGCTGCCAGCAGAGCATATCTGCACAGTGCATGCCATGAAAAGACAGGACTTAGCGCAGAATAT
GCAGATTATGACGGAAAGCCTCATACGGGGCATCAGGAAATATTTGGAAGACATGACTGGTATTACAGTGATGCATACCG
CACGATCGCCAATATAGCGATGGATCATCTGTGGTTTGATGCAGATCCGTGGCAGATTAAAACGGCAGAAAGGCTTCAGA
AGTTTTATTGTGAGGATCAGAAGGACAATTGGGATGGGGTATTTCTTATAGATGGTACACCGCTTGATGAGAAGGCACTT
CATCCGGTAGCAATCATTGCTGTTAATGCAGAAGCTTCACTCGCAGCAGATGGAAAATATGCAAAGCAATGTGTTGAAAA
GTTCTGGAACACTCCGCTTAGGACAGGTGACAGGAGATACTATGACAATTTCCTTTACATGTTTGCAATGTTAGCACTTT
CAGGAAATTACAGGATTTATTGA

Upstream 100 bases:

>100_bases
GTTCAAAAAAGGAGATAATGAATCCTGGACATCATGCAGACACAGATTTTTAAATTTCATGTGCGGGATACAGTAAAACA
GCGACAAAAAGGAGAGAAAA

Downstream 100 bases:

>100_bases
TTTTAATATACAAGAACCTTAAGCTGGAATGATGAAACAGTCATAAACTATAAAAGACAGGACAAATATCTATAATTTCT
CCCGGTGCAAAGCACCGGGA

Product: xylanase Y

Products: NA

Alternate protein names: Rex [H]

Number of amino acids: Translated: 380; Mature: 379

Protein sequence:

>380_residues
MAGAYKTGKYRNIFKEYGYPEEEIQKRVEDTFNTIFYGNDDERFYHEAGDDMGYMEDTGNHDVRTEGMSYGMMVCVQLDK
KAEFDRLWKWVRTYMYIEDGPAKNYFAWSCQTNGKRNADGPAPDGEEYFAMALFFASKRWGDGDGIFCYSKEAQNILREC
VHKGEPGHSGEPMWEPSNKLIKFVTNMDFSDPSYHLPHFYELFAQRAYEEDRDFWKEAAAASRAYLHSACHEKTGLSAEY
ADYDGKPHTGHQEIFGRHDWYYSDAYRTIANIAMDHLWFDADPWQIKTAERLQKFYCEDQKDNWDGVFLIDGTPLDEKAL
HPVAIIAVNAEASLAADGKYAKQCVEKFWNTPLRTGDRRYYDNFLYMFAMLALSGNYRIY

Sequences:

>Translated_380_residues
MAGAYKTGKYRNIFKEYGYPEEEIQKRVEDTFNTIFYGNDDERFYHEAGDDMGYMEDTGNHDVRTEGMSYGMMVCVQLDK
KAEFDRLWKWVRTYMYIEDGPAKNYFAWSCQTNGKRNADGPAPDGEEYFAMALFFASKRWGDGDGIFCYSKEAQNILREC
VHKGEPGHSGEPMWEPSNKLIKFVTNMDFSDPSYHLPHFYELFAQRAYEEDRDFWKEAAAASRAYLHSACHEKTGLSAEY
ADYDGKPHTGHQEIFGRHDWYYSDAYRTIANIAMDHLWFDADPWQIKTAERLQKFYCEDQKDNWDGVFLIDGTPLDEKAL
HPVAIIAVNAEASLAADGKYAKQCVEKFWNTPLRTGDRRYYDNFLYMFAMLALSGNYRIY
>Mature_379_residues
AGAYKTGKYRNIFKEYGYPEEEIQKRVEDTFNTIFYGNDDERFYHEAGDDMGYMEDTGNHDVRTEGMSYGMMVCVQLDKK
AEFDRLWKWVRTYMYIEDGPAKNYFAWSCQTNGKRNADGPAPDGEEYFAMALFFASKRWGDGDGIFCYSKEAQNILRECV
HKGEPGHSGEPMWEPSNKLIKFVTNMDFSDPSYHLPHFYELFAQRAYEEDRDFWKEAAAASRAYLHSACHEKTGLSAEYA
DYDGKPHTGHQEIFGRHDWYYSDAYRTIANIAMDHLWFDADPWQIKTAERLQKFYCEDQKDNWDGVFLIDGTPLDEKALH
PVAIIAVNAEASLAADGKYAKQCVEKFWNTPLRTGDRRYYDNFLYMFAMLALSGNYRIY

Specific function: Hydrolyzes xylooligosaccharides with a degree of polymerization of greater than or equal to 3, releasing xylose from the reducing end. Only hydrolyzes the beta anomers of xylooligosaccharides, with inversion of anomeric configuration. Hydrolyzes the gluco

COG id: COG3405

COG function: function code G; Endoglucanase Y

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Belongs to the glycosyl hydrolase 8 (cellulase D) family [H]

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR008928
- InterPro:   IPR012341
- InterPro:   IPR002037 [H]

Pfam domain/function: PF01270 Glyco_hydro_8 [H]

EC number: =3.2.1.156 [H]

Molecular weight: Translated: 44330; Mature: 44198

Theoretical pI: Translated: 4.89; Mature: 4.89

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.8 %Cys     (Translated Protein)
3.4 %Met     (Translated Protein)
5.3 %Cys+Met (Translated Protein)
1.8 %Cys     (Mature Protein)
3.2 %Met     (Mature Protein)
5.0 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MAGAYKTGKYRNIFKEYGYPEEEIQKRVEDTFNTIFYGNDDERFYHEAGDDMGYMEDTGN
CCCCCCCCHHHHHHHHCCCCHHHHHHHHHHHHHEEEECCCCHHHHHHCCCCCCCCCCCCC
HDVRTEGMSYGMMVCVQLDKKAEFDRLWKWVRTYMYIEDGPAKNYFAWSCQTNGKRNADG
CCCEECCCCCCEEEEEEECCCCCHHHHHHHHHHHEEEECCCCCCEEEEEECCCCCCCCCC
PAPDGEEYFAMALFFASKRWGDGDGIFCYSKEAQNILRECVHKGEPGHSGEPMWEPSNKL
CCCCCHHHHHHHHHHHHCCCCCCCCEEEECHHHHHHHHHHHHCCCCCCCCCCCCCCHHHH
IKFVTNMDFSDPSYHLPHFYELFAQRAYEEDRDFWKEAAAASRAYLHSACHEKTGLSAEY
HHHHHCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCC
ADYDGKPHTGHQEIFGRHDWYYSDAYRTIANIAMDHLWFDADPWQIKTAERLQKFYCEDQ
CCCCCCCCCCHHHHCCCCCCCHHHHHHHHHHHHHHHHCCCCCCCEECHHHHHHHHHCCCC
KDNWDGVFLIDGTPLDEKALHPVAIIAVNAEASLAADGKYAKQCVEKFWNTPLRTGDRRY
CCCCCEEEEECCCCCCCCCCCCEEEEEECCCCCCCCCCHHHHHHHHHHCCCCCCCCCHHH
YDNFLYMFAMLALSGNYRIY
HHHHHHHHHHHHHCCCCEEC
>Mature Secondary Structure 
AGAYKTGKYRNIFKEYGYPEEEIQKRVEDTFNTIFYGNDDERFYHEAGDDMGYMEDTGN
CCCCCCCHHHHHHHHCCCCHHHHHHHHHHHHHEEEECCCCHHHHHHCCCCCCCCCCCCC
HDVRTEGMSYGMMVCVQLDKKAEFDRLWKWVRTYMYIEDGPAKNYFAWSCQTNGKRNADG
CCCEECCCCCCEEEEEEECCCCCHHHHHHHHHHHEEEECCCCCCEEEEEECCCCCCCCCC
PAPDGEEYFAMALFFASKRWGDGDGIFCYSKEAQNILRECVHKGEPGHSGEPMWEPSNKL
CCCCCHHHHHHHHHHHHCCCCCCCCEEEECHHHHHHHHHHHHCCCCCCCCCCCCCCHHHH
IKFVTNMDFSDPSYHLPHFYELFAQRAYEEDRDFWKEAAAASRAYLHSACHEKTGLSAEY
HHHHHCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCC
ADYDGKPHTGHQEIFGRHDWYYSDAYRTIANIAMDHLWFDADPWQIKTAERLQKFYCEDQ
CCCCCCCCCCHHHHCCCCCCCHHHHHHHHHHHHHHHHCCCCCCCEECHHHHHHHHHCCCC
KDNWDGVFLIDGTPLDEKALHPVAIIAVNAEASLAADGKYAKQCVEKFWNTPLRTGDRRY
CCCCCEEEEECCCCCCCCCCCCEEEEEECCCCCCCCCCHHHHHHHHHHCCCCCCCCCHHH
YDNFLYMFAMLALSGNYRIY
HHHHHHHHHHHHHCCCCEEC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 11058132 [H]