Definition Gloeobacter violaceus PCC 7421 chromosome, complete genome.
Accession NC_005125
Length 4,659,019

Click here to switch to the map view.

The map label for this gene is endo I [H]

Identifier: 37523274

GI number: 37523274

Start: 3912671

End: 3915277

Strand: Reverse

Name: endo I [H]

Synonym: gll3705

Alternate gene names: 37523274

Gene position: 3915277-3912671 (Counterclockwise)

Preceding gene: 37523275

Following gene: 37523273

Centisome position: 84.04

GC content: 61.91

Gene sequence:

>2607_bases
ATGCCGACATTTCAGCCGCGGGCCGGGCGTCTGGCCGCGGGCGGATTCATTGTACTTGTGTTGTCTTTTTTTCTGGTAAG
CCCGGCTGCGGCCGCTCGCAACTGGTGGGTGTTTCTTTCACCCACCGAGGCCGAACTGCTCTACAAAGCGGCGAGTTTCA
GCGCGATTAAAAGCGAAGTGGACAACGACTATCTCAACGGTCTGAGTGAACCTAAGACCTGCCTGGATACCCGTTCGCCG
TGGGTGCAGCAGATGGCCGCCGCCCAGGAAATGCTCTCAGCCACCTACCTCGCCCTCAAATGGGGCAAATACGGCGGTGC
CGACAACAGCGAACTGGACGCCTACCGCGAGCGGATCGCCGACAACTGGAAAGCCATCCTCGAAGCCGGACCGATCGACC
TCTGGCAGGACAACTTCGACGGTGTCACGCGCCAGTTCGTCGCCGGCGGCTGCGATTATACCCAGTCCTACCAACCGGGC
TGGTACGAGGGGGACATCGCCCTGCGCTTCTGGATATTTGGCGCTCTGCCTTCTTATGATGCGGTGCGCGACGAGCTGAG
CACTTCCGAGCGCGAGGCGATCGACACATGGTTGCGGGGATTGGCGGACCAGCTGTGGTCGGGTCGCGATTTTGGTCGGG
AGCACAACCGGGGGGCGAGTGCAGTGGCCCAGGCGCACGTGATTGCCCTGGTGCTGCAGGACCGTTCGCGCTTCGAGTCG
TACTATTCGCATGCGAGTGGGGGGTTGAAAGATTATTACCGGCAGATGAACTACGCTCCGCTGGCCGGGTGCGACTTTCC
CGAACGCCCGGGACTGACCTCTGAACTGGCAAGCCGCGACGGTATTCACGGTGTGCAAACGGTGATGCACAGCTTCGGCG
CGCTCGCGGTGATCGCCCACGCGGGGCACATGGGGGGCAACGTCGACTGGAACATCTACAACACCACCCGGGATCCGAAT
CTGCTGGCCGGTGTCCTGGGTACCTGGTACGACATCGAAGAGGCCTTGCGCGATGAATTCAACTCCTATATCGTCTGTCT
GGAAAATGAGACAGATGCTTCGGAAAGCTTCGAGGACACGAGCCTCGACGAGCGCGTCTGGGCGCCGCTGGCCTTTTTTC
AGACCCGCTTTCAGAATGTCGATTCGTGGGGACTGGGCAACCTGCGCGCCTTGAGAAAGGAGCGCGCTTCGCTGCACGCC
CAGAACCGGCTGGCCAACCAGAAGCCGACCGTCGAGCTGACCGCGCCCGCCTCCGGCGCAAAATTGACGGCACCGGCCAC
GGTCACCCTGAATGCTGAAGCCCGCGACAATAACGGTACTGTGAGCAAAGTCGAGTTTTTCCGCGACAGCACCAAAATTG
GCGAGGACCTTGCCAGCCCCTACTCCGCCACCTGGAAGCTCGCAGAAGCTGGAACCTATGCGCTGAAGGCCAAAGTGACC
GACAGCCAGGGTGTCACCGCCGATTCCACCTCCCGGACGATCACGGTCTCCCAGCCTTCGGGGTTGTCGGTGTACCTGGT
ACAACCCCTCGACGGGGCGTTCGTGGCCGGCGGTTCGGATGCGAAGCTGCAGGCGGTGGCCGCCCACAGTTCCGACAGCA
TCAGCAAGGTGGAATTTTATCAAGGTTCCACCAAACTCGGTTCCGACTCGGCAAGCCCCTACTTCTACACCTGGGTCAAG
CCCCCGTCGGGCAGCTACTCGTTGACGGCAAAGGCGATCAGCAGCACTGGGGCCACAATCACCTCCAGTGCAATCGATCT
GAGCGTCGGCTCACCCAACACTGCGCCGACGGCGAATATGGTCGATCCGGAGGACGGCGCCCAGCTAACGGCTCCCGCGA
CGGTCAGCCTCCACGCCGAAGCCGACGACAGCGACGGCACAATCAGCCAAGTCGAGTTTTTCAGCGGCGGCGTCAAACTC
GGCCAGGACACCACATCGCCTTACTACTTCAGCTGGAAGGGCATGGCGGCGGGCAAGTATTCGATTGCGGCGGTGGCCAC
GGACAACCGGGGGGCCGTGTTTACCTCCGCCGCGGTGGGTGTCACCGTGTCGCTGCCGACTCCCTGGCAACTTAAAGACA
TCGGCAATGTCGGCCTGACCGGCAATGCGGCGTTCAACCCCGATAGCGACACCTTCACGATCAAAGCCGCCGGGGCGGAC
ATCTGGGGCGATGCCGACGGCTTTATGTATGTCTACCAGCCCATCTCGGGCGATGGGCAATTGGTGGCGCGCGTTTCGAG
CCTGGGCAACACCGACAGCTGGGCCAAAGCGGGGATCATGATCCGCGACGGCTTTACCTCCAGTGCCCGCAACGTGTTTG
TCGGTCTCACCCCGAGCAAAGGCATCACCTTTCAGTACCGGACCAAGACCGGCGGAGACAGCGGCTCCAAGACCGTCGCC
GGCTACAAAGCGCCCTACTGGCTCAAACTGGTGCGCACCGGCGACACGATCAAAGGCTACTACTCCAGCAACGGCGGCAG
TTGGGTCTGGATCGGCACCCAGAGCATCCCGATGGCGACGGACCTGTTCATGGGTCTGGCCGTCACCAGCCACGACAGCG
CCGAGTTGACGACGGCTGCTTTCACCGATGTGAGCGCCAGCAAGTAA

Upstream 100 bases:

>100_bases
TCGCCTTCCGGAAAGTATACGTCGCTCAGACGGCTCCAAAATGGACCCACTCGGGCAGTCATCTTTTCAGATTTAATCAC
AAATTCCACCGAGAACTATT

Downstream 100 bases:

>100_bases
CCTCGCTCACACGAGAACCGAAAACGTTGAAGCGCCGTCTTGGCTACCGAGGCCGAGGCGGCACCATTTTTTGTCGCTAC
GTGGGCTATACCGATGCGCT

Product: hypothetical protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 868; Mature: 867

Protein sequence:

>868_residues
MPTFQPRAGRLAAGGFIVLVLSFFLVSPAAAARNWWVFLSPTEAELLYKAASFSAIKSEVDNDYLNGLSEPKTCLDTRSP
WVQQMAAAQEMLSATYLALKWGKYGGADNSELDAYRERIADNWKAILEAGPIDLWQDNFDGVTRQFVAGGCDYTQSYQPG
WYEGDIALRFWIFGALPSYDAVRDELSTSEREAIDTWLRGLADQLWSGRDFGREHNRGASAVAQAHVIALVLQDRSRFES
YYSHASGGLKDYYRQMNYAPLAGCDFPERPGLTSELASRDGIHGVQTVMHSFGALAVIAHAGHMGGNVDWNIYNTTRDPN
LLAGVLGTWYDIEEALRDEFNSYIVCLENETDASESFEDTSLDERVWAPLAFFQTRFQNVDSWGLGNLRALRKERASLHA
QNRLANQKPTVELTAPASGAKLTAPATVTLNAEARDNNGTVSKVEFFRDSTKIGEDLASPYSATWKLAEAGTYALKAKVT
DSQGVTADSTSRTITVSQPSGLSVYLVQPLDGAFVAGGSDAKLQAVAAHSSDSISKVEFYQGSTKLGSDSASPYFYTWVK
PPSGSYSLTAKAISSTGATITSSAIDLSVGSPNTAPTANMVDPEDGAQLTAPATVSLHAEADDSDGTISQVEFFSGGVKL
GQDTTSPYYFSWKGMAAGKYSIAAVATDNRGAVFTSAAVGVTVSLPTPWQLKDIGNVGLTGNAAFNPDSDTFTIKAAGAD
IWGDADGFMYVYQPISGDGQLVARVSSLGNTDSWAKAGIMIRDGFTSSARNVFVGLTPSKGITFQYRTKTGGDSGSKTVA
GYKAPYWLKLVRTGDTIKGYYSSNGGSWVWIGTQSIPMATDLFMGLAVTSHDSAELTTAAFTDVSASK

Sequences:

>Translated_868_residues
MPTFQPRAGRLAAGGFIVLVLSFFLVSPAAAARNWWVFLSPTEAELLYKAASFSAIKSEVDNDYLNGLSEPKTCLDTRSP
WVQQMAAAQEMLSATYLALKWGKYGGADNSELDAYRERIADNWKAILEAGPIDLWQDNFDGVTRQFVAGGCDYTQSYQPG
WYEGDIALRFWIFGALPSYDAVRDELSTSEREAIDTWLRGLADQLWSGRDFGREHNRGASAVAQAHVIALVLQDRSRFES
YYSHASGGLKDYYRQMNYAPLAGCDFPERPGLTSELASRDGIHGVQTVMHSFGALAVIAHAGHMGGNVDWNIYNTTRDPN
LLAGVLGTWYDIEEALRDEFNSYIVCLENETDASESFEDTSLDERVWAPLAFFQTRFQNVDSWGLGNLRALRKERASLHA
QNRLANQKPTVELTAPASGAKLTAPATVTLNAEARDNNGTVSKVEFFRDSTKIGEDLASPYSATWKLAEAGTYALKAKVT
DSQGVTADSTSRTITVSQPSGLSVYLVQPLDGAFVAGGSDAKLQAVAAHSSDSISKVEFYQGSTKLGSDSASPYFYTWVK
PPSGSYSLTAKAISSTGATITSSAIDLSVGSPNTAPTANMVDPEDGAQLTAPATVSLHAEADDSDGTISQVEFFSGGVKL
GQDTTSPYYFSWKGMAAGKYSIAAVATDNRGAVFTSAAVGVTVSLPTPWQLKDIGNVGLTGNAAFNPDSDTFTIKAAGAD
IWGDADGFMYVYQPISGDGQLVARVSSLGNTDSWAKAGIMIRDGFTSSARNVFVGLTPSKGITFQYRTKTGGDSGSKTVA
GYKAPYWLKLVRTGDTIKGYYSSNGGSWVWIGTQSIPMATDLFMGLAVTSHDSAELTTAAFTDVSASK
>Mature_867_residues
PTFQPRAGRLAAGGFIVLVLSFFLVSPAAAARNWWVFLSPTEAELLYKAASFSAIKSEVDNDYLNGLSEPKTCLDTRSPW
VQQMAAAQEMLSATYLALKWGKYGGADNSELDAYRERIADNWKAILEAGPIDLWQDNFDGVTRQFVAGGCDYTQSYQPGW
YEGDIALRFWIFGALPSYDAVRDELSTSEREAIDTWLRGLADQLWSGRDFGREHNRGASAVAQAHVIALVLQDRSRFESY
YSHASGGLKDYYRQMNYAPLAGCDFPERPGLTSELASRDGIHGVQTVMHSFGALAVIAHAGHMGGNVDWNIYNTTRDPNL
LAGVLGTWYDIEEALRDEFNSYIVCLENETDASESFEDTSLDERVWAPLAFFQTRFQNVDSWGLGNLRALRKERASLHAQ
NRLANQKPTVELTAPASGAKLTAPATVTLNAEARDNNGTVSKVEFFRDSTKIGEDLASPYSATWKLAEAGTYALKAKVTD
SQGVTADSTSRTITVSQPSGLSVYLVQPLDGAFVAGGSDAKLQAVAAHSSDSISKVEFYQGSTKLGSDSASPYFYTWVKP
PSGSYSLTAKAISSTGATITSSAIDLSVGSPNTAPTANMVDPEDGAQLTAPATVSLHAEADDSDGTISQVEFFSGGVKLG
QDTTSPYYFSWKGMAAGKYSIAAVATDNRGAVFTSAAVGVTVSLPTPWQLKDIGNVGLTGNAAFNPDSDTFTIKAAGADI
WGDADGFMYVYQPISGDGQLVARVSSLGNTDSWAKAGIMIRDGFTSSARNVFVGLTPSKGITFQYRTKTGGDSGSKTVAG
YKAPYWLKLVRTGDTIKGYYSSNGGSWVWIGTQSIPMATDLFMGLAVTSHDSAELTTAAFTDVSASK

Specific function: Hydrolyzes chitin oligosaccharides; (GlcNAc)4 to (GlcNAc)2 and (GlcNAc)5,6 to (GlcNAc)2 and (GlcNAc)3. Inactive towards chitin, glucosamine oligosaccharides, glycoproteins and glycopeptides containing (GlcNAc)2 [H]

COG id: COG3979

COG function: function code R; Uncharacterized protein contain chitin-binding domain type 3

Gene ontology:

Cell location: Periplasm (Probable) [H]

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Belongs to the glycosyl hydrolase 18 family [H]

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR003610
- InterPro:   IPR009470
- InterPro:   IPR011583
- InterPro:   IPR001223
- InterPro:   IPR017853
- InterPro:   IPR013781 [H]

Pfam domain/function: PF02839 CBM_5_12; PF06483 ChiC; PF00704 Glyco_hydro_18 [H]

EC number: =3.2.1.14 [H]

Molecular weight: Translated: 93270; Mature: 93139

Theoretical pI: Translated: 4.73; Mature: 4.73

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.5 %Cys     (Translated Protein)
1.4 %Met     (Translated Protein)
1.8 %Cys+Met (Translated Protein)
0.5 %Cys     (Mature Protein)
1.3 %Met     (Mature Protein)
1.7 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MPTFQPRAGRLAAGGFIVLVLSFFLVSPAAAARNWWVFLSPTEAELLYKAASFSAIKSEV
CCCCCCCCCCEECCHHHHHHHHHHHHCCCHHCCCEEEEECCCHHHHHHHHHHHHHHHHHH
DNDYLNGLSEPKTCLDTRSPWVQQMAAAQEMLSATYLALKWGKYGGADNSELDAYRERIA
CCHHHCCCCCCHHHHCCCCHHHHHHHHHHHHHHHHEEEEEECCCCCCCCCHHHHHHHHHH
DNWKAILEAGPIDLWQDNFDGVTRQFVAGGCDYTQSYQPGWYEGDIALRFWIFGALPSYD
HHHHHHHHCCCCCCCCCCCHHHHHHHHHCCCCCCCCCCCCEECCCEEEEEEEEECCCCHH
AVRDELSTSEREAIDTWLRGLADQLWSGRDFGREHNRGASAVAQAHVIALVLQDRSRFES
HHHHHHCCHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCHHHHHHHHEEEEEEHHHHHHHH
YYSHASGGLKDYYRQMNYAPLAGCDFPERPGLTSELASRDGIHGVQTVMHSFGALAVIAH
HHHHCCCCHHHHHHHCCCCCCCCCCCCCCCCCHHHHHHCCCCHHHHHHHHHHCHHEEEHH
AGHMGGNVDWNIYNTTRDPNLLAGVLGTWYDIEEALRDEFNSYIVCLENETDASESFEDT
CCCCCCCEEEEEEECCCCCHHHHHHHHHHHHHHHHHHHCCCCEEEEECCCCCCCCCCCCC
SLDERVWAPLAFFQTRFQNVDSWGLGNLRALRKERASLHAQNRLANQKPTVELTAPASGA
CCHHHHHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHHCCCCCCEEEECCCCCC
KLTAPATVTLNAEARDNNGTVSKVEFFRDSTKIGEDLASPYSATWKLAEAGTYALKAKVT
EEECCEEEEEEECCCCCCCCEEEEHHHHHHHHHHHHHCCCCHHEEEEECCCCEEEEEEEC
DSQGVTADSTSRTITVSQPSGLSVYLVQPLDGAFVAGGSDAKLQAVAAHSSDSISKVEFY
CCCCCCCCCCCCEEEEECCCCCEEEEECCCCCEEEECCCCCEEEEEEECCCCCCEEEEEE
QGSTKLGSDSASPYFYTWVKPPSGSYSLTAKAISSTGATITSSAIDLSVGSPNTAPTANM
CCCCCCCCCCCCCEEEEEECCCCCCEEEEEEECCCCCCEEEECEEEEECCCCCCCCCCCC
VDPEDGAQLTAPATVSLHAEADDSDGTISQVEFFSGGVKLGQDTTSPYYFSWKGMAAGKY
CCCCCCCEEECCEEEEEEECCCCCCCCCEEEEEECCCEEECCCCCCCEEEEECCCCCCCE
SIAAVATDNRGAVFTSAAVGVTVSLPTPWQLKDIGNVGLTGNAAFNPDSDTFTIKAAGAD
EEEEEEECCCCCEEEEEEEEEEEECCCCCCCCCCCCCCCCCCCCCCCCCCEEEEEECCCC
IWGDADGFMYVYQPISGDGQLVARVSSLGNTDSWAKAGIMIRDGFTSSARNVFVGLTPSK
CCCCCCCEEEEEEECCCCCCEEHHHHHCCCCCCHHHCCEEEECCCCCCCCEEEEEECCCC
GITFQYRTKTGGDSGSKTVAGYKAPYWLKLVRTGDTIKGYYSSNGGSWVWIGTQSIPMAT
CEEEEEEECCCCCCCCCEEECCCCCEEEEEEECCCCEEEEEECCCCEEEEEECCCCCCHH
DLFMGLAVTSHDSAELTTAAFTDVSASK
HHHHHEEEECCCCCCEEEEEECCCCCCC
>Mature Secondary Structure 
PTFQPRAGRLAAGGFIVLVLSFFLVSPAAAARNWWVFLSPTEAELLYKAASFSAIKSEV
CCCCCCCCCEECCHHHHHHHHHHHHCCCHHCCCEEEEECCCHHHHHHHHHHHHHHHHHH
DNDYLNGLSEPKTCLDTRSPWVQQMAAAQEMLSATYLALKWGKYGGADNSELDAYRERIA
CCHHHCCCCCCHHHHCCCCHHHHHHHHHHHHHHHHEEEEEECCCCCCCCCHHHHHHHHHH
DNWKAILEAGPIDLWQDNFDGVTRQFVAGGCDYTQSYQPGWYEGDIALRFWIFGALPSYD
HHHHHHHHCCCCCCCCCCCHHHHHHHHHCCCCCCCCCCCCEECCCEEEEEEEEECCCCHH
AVRDELSTSEREAIDTWLRGLADQLWSGRDFGREHNRGASAVAQAHVIALVLQDRSRFES
HHHHHHCCHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCHHHHHHHHEEEEEEHHHHHHHH
YYSHASGGLKDYYRQMNYAPLAGCDFPERPGLTSELASRDGIHGVQTVMHSFGALAVIAH
HHHHCCCCHHHHHHHCCCCCCCCCCCCCCCCCHHHHHHCCCCHHHHHHHHHHCHHEEEHH
AGHMGGNVDWNIYNTTRDPNLLAGVLGTWYDIEEALRDEFNSYIVCLENETDASESFEDT
CCCCCCCEEEEEEECCCCCHHHHHHHHHHHHHHHHHHHCCCCEEEEECCCCCCCCCCCCC
SLDERVWAPLAFFQTRFQNVDSWGLGNLRALRKERASLHAQNRLANQKPTVELTAPASGA
CCHHHHHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHHCCCCCCEEEECCCCCC
KLTAPATVTLNAEARDNNGTVSKVEFFRDSTKIGEDLASPYSATWKLAEAGTYALKAKVT
EEECCEEEEEEECCCCCCCCEEEEHHHHHHHHHHHHHCCCCHHEEEEECCCCEEEEEEEC
DSQGVTADSTSRTITVSQPSGLSVYLVQPLDGAFVAGGSDAKLQAVAAHSSDSISKVEFY
CCCCCCCCCCCCEEEEECCCCCEEEEECCCCCEEEECCCCCEEEEEEECCCCCCEEEEEE
QGSTKLGSDSASPYFYTWVKPPSGSYSLTAKAISSTGATITSSAIDLSVGSPNTAPTANM
CCCCCCCCCCCCCEEEEEECCCCCCEEEEEEECCCCCCEEEECEEEEECCCCCCCCCCCC
VDPEDGAQLTAPATVSLHAEADDSDGTISQVEFFSGGVKLGQDTTSPYYFSWKGMAAGKY
CCCCCCCEEECCEEEEEEECCCCCCCCCEEEEEECCCEEECCCCCCCEEEEECCCCCCCE
SIAAVATDNRGAVFTSAAVGVTVSLPTPWQLKDIGNVGLTGNAAFNPDSDTFTIKAAGAD
EEEEEEECCCCCEEEEEEEEEEEECCCCCCCCCCCCCCCCCCCCCCCCCCEEEEEECCCC
IWGDADGFMYVYQPISGDGQLVARVSSLGNTDSWAKAGIMIRDGFTSSARNVFVGLTPSK
CCCCCCCEEEEEEECCCCCCEEHHHHHCCCCCCHHHCCEEEECCCCCCCCEEEEEECCCC
GITFQYRTKTGGDSGSKTVAGYKAPYWLKLVRTGDTIKGYYSSNGGSWVWIGTQSIPMAT
CEEEEEEECCCCCCCCCEEECCCCCEEEEEEECCCCEEEEEECCCCEEEEEECCCCCCHH
DLFMGLAVTSHDSAELTTAAFTDVSASK
HHHHHEEEECCCCCCEEEEEECCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 8969204 [H]