Definition Candidatus Solibacter usitatus Ellin6076 chromosome, complete genome.
Accession NC_008536
Length 9,965,640

Click here to switch to the map view.

The map label for this gene is 116621773

Identifier: 116621773

GI number: 116621773

Start: 3360265

End: 3361641

Strand: Reverse

Name: 116621773

Synonym: Acid_2655

Alternate gene names: NA

Gene position: 3361641-3360265 (Counterclockwise)

Preceding gene: 116621776

Following gene: 116621771

Centisome position: 33.73

GC content: 61.51

Gene sequence:

>1377_bases
ATGAAAAGTCCAAGTTTATCGCTAAAAGTCTGTACCGCGATGCTGTGCGGCTGGGCCGCCATCGCGCAGCCCGGCGCCAA
GCCACTGCCCGCGCCGAAATCGCAGGACGAGAGGATGGCATGGTTCCGCGAGGCCAAATTCGGCCTCTTCATCCACTGGG
GTCTCTACTCCATTCCCGCCGGCGAGTGGAAGGGCCAGCCCATCGCCGGCATCGGCGAGTGGATTATGAATCGCGCCAAA
ATTCCCGTCGCGGAATATGAGCAGCTCGCCACCCGGTTCAACCCCGTGAAGTTCAATGCGGAAGAGTGGGTCCAGATGGC
CCAGGACGCCGGCATGAAGTACATCGTGATCACCAGCAAGCACCACGATGGCTTCGCCATGTACGGCTCCAAGGTCAGCA
AGTACAACATCGTGGACGCCACTCCGTTCCACCGCGACCCGCTGAAGGAACTCTCCGAAGCCTGCGCGCGCCACGGCCTC
AAGTTCGGCTTCTACTACTCCCAGTCGCAGGATTGGCACGAGCCCGGCGGCATGGGCAACACCTGGGACTTCGGCCCCGA
CGCCGCGAAGGAACCGATCTACGACGAATACCTGCGCGGCAAGGCCGAACCGCAGGTGAAGGAGCTCCTCGCCAACTACG
GCCCGGTCGCGCTGATCTGGTTCGATACGGCCCGCTCCATGACCGGAGATCGCGGCCCCCGCTTCATCGACATCCTGCGC
ACCATGCAGCCCGCCACCCTCATCGATGGCCGCCTCGGCGTCAAGGGCGACTATGTCTCCACCGGCGACAATCAGATTCC
CAACCAGGTTCTTCACGAAGACTGGGAAGTTCCGGCGACGCTCAACAAGACCTGGGGATTCAAGAAGGATGACACCGATT
GGAAGACGCCGCAGGACCTCCAGTTCAAGCTGGTCGATATCGTCAGCAAGGGCGGCAACTACCTGCTCAACGTGGGACCG
ACTTCCGAAGGCGTGATCCCGCAGGCCAGCCAGGATAACCTGCGCGCCGTCGGCAAATGGCTCAAGGTCAACGGCGAGTC
CGTCTACGGCGCCGGCGCCACGCCCTTCGGGCCGGAGCTCGGCGAAGTGGACAACACCACCAAGGACAAGAAGGGCAACC
CAGGCTTCAAGATCGCCAAGGATTGGCGCTGCACCACCAAGCCCGGCAAGCTCTACATTCACCTCTTCAAGTACCCCGCC
GGATCCTTCGAGCTATCGAAAGTCTCCGGCAAGGTACAGAAGGCTTACCTGCTGGCCGACGCGAAGCACTCCTCGCTGAA
GCTGAAGCAGTCCGGCGATACCGTCACTGTGACTTTACCGGCGAACGCTCCGGATGAGATGGATTCGGTGCTCGTACTGC
AGACGGCGTCAAAATAA

Upstream 100 bases:

>100_bases
CTTCACCACTCAAATCTAACATCGTCCGGAAGCAGAGGTTTAGCTTCACTTGAATTCGGCGGCGCTTTGTGAGCAAATAG
GGGATCACCACGGAGTGACC

Downstream 100 bases:

>100_bases
CGCAAATGCCCGGATGTTCCGAACATCCGGGCGTTCAGATTTCCTTGTAGAAGAACACGGTAGCGTGCAAAGCGCCATCC
GCGCCGCGCGCATAGCGCGG

Product: alpha-L-fucosidase

Products: NA

Alternate protein names: Glycoside Hydrolase Family; Glycosyl Hydrolase; Coagulation Factor 5/8 Type Domain Protein; Alpha-L-Fucosidase Protein; Exported Alpha-L-Fucosidase Protein; Alpha-1 3/4-Fucosidase; Glycoside Hydrolase Family Alpha-L-Fucosidase; Lipoprotein; Exporte Hydrolase; Fucosidase; Calx-Beta Domain-Containing Protein; Alpha-L-Fucosidase Family Protein; Family; Twin-Arginine Translocation Pathway Signal; Alpha-L-Fucosidase Superfamily; Glycosyl Hydrolase Alpha-L-Fucosidase; Exported Hydrolase; Exported Fucosidase; Coagulation Factor 5/8 Type Domain-Containing Protein; Alpha-L-Fucosidase-Like Protein; DS Domain-Containing Protein; Glycoside Hydrolase

Number of amino acids: Translated: 458; Mature: 458

Protein sequence:

>458_residues
MKSPSLSLKVCTAMLCGWAAIAQPGAKPLPAPKSQDERMAWFREAKFGLFIHWGLYSIPAGEWKGQPIAGIGEWIMNRAK
IPVAEYEQLATRFNPVKFNAEEWVQMAQDAGMKYIVITSKHHDGFAMYGSKVSKYNIVDATPFHRDPLKELSEACARHGL
KFGFYYSQSQDWHEPGGMGNTWDFGPDAAKEPIYDEYLRGKAEPQVKELLANYGPVALIWFDTARSMTGDRGPRFIDILR
TMQPATLIDGRLGVKGDYVSTGDNQIPNQVLHEDWEVPATLNKTWGFKKDDTDWKTPQDLQFKLVDIVSKGGNYLLNVGP
TSEGVIPQASQDNLRAVGKWLKVNGESVYGAGATPFGPELGEVDNTTKDKKGNPGFKIAKDWRCTTKPGKLYIHLFKYPA
GSFELSKVSGKVQKAYLLADAKHSSLKLKQSGDTVTVTLPANAPDEMDSVLVLQTASK

Sequences:

>Translated_458_residues
MKSPSLSLKVCTAMLCGWAAIAQPGAKPLPAPKSQDERMAWFREAKFGLFIHWGLYSIPAGEWKGQPIAGIGEWIMNRAK
IPVAEYEQLATRFNPVKFNAEEWVQMAQDAGMKYIVITSKHHDGFAMYGSKVSKYNIVDATPFHRDPLKELSEACARHGL
KFGFYYSQSQDWHEPGGMGNTWDFGPDAAKEPIYDEYLRGKAEPQVKELLANYGPVALIWFDTARSMTGDRGPRFIDILR
TMQPATLIDGRLGVKGDYVSTGDNQIPNQVLHEDWEVPATLNKTWGFKKDDTDWKTPQDLQFKLVDIVSKGGNYLLNVGP
TSEGVIPQASQDNLRAVGKWLKVNGESVYGAGATPFGPELGEVDNTTKDKKGNPGFKIAKDWRCTTKPGKLYIHLFKYPA
GSFELSKVSGKVQKAYLLADAKHSSLKLKQSGDTVTVTLPANAPDEMDSVLVLQTASK
>Mature_458_residues
MKSPSLSLKVCTAMLCGWAAIAQPGAKPLPAPKSQDERMAWFREAKFGLFIHWGLYSIPAGEWKGQPIAGIGEWIMNRAK
IPVAEYEQLATRFNPVKFNAEEWVQMAQDAGMKYIVITSKHHDGFAMYGSKVSKYNIVDATPFHRDPLKELSEACARHGL
KFGFYYSQSQDWHEPGGMGNTWDFGPDAAKEPIYDEYLRGKAEPQVKELLANYGPVALIWFDTARSMTGDRGPRFIDILR
TMQPATLIDGRLGVKGDYVSTGDNQIPNQVLHEDWEVPATLNKTWGFKKDDTDWKTPQDLQFKLVDIVSKGGNYLLNVGP
TSEGVIPQASQDNLRAVGKWLKVNGESVYGAGATPFGPELGEVDNTTKDKKGNPGFKIAKDWRCTTKPGKLYIHLFKYPA
GSFELSKVSGKVQKAYLLADAKHSSLKLKQSGDTVTVTLPANAPDEMDSVLVLQTASK

Specific function: Unknown

COG id: COG3669

COG function: function code G; Alpha-L-fucosidase

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

Organism=Homo sapiens, GI40068512, Length=350, Percent_Identity=34.5714285714286, Blast_Score=168, Evalue=8e-42,
Organism=Homo sapiens, GI119360348, Length=352, Percent_Identity=33.8068181818182, Blast_Score=164, Evalue=2e-40,
Organism=Caenorhabditis elegans, GI71997700, Length=463, Percent_Identity=27.4298056155508, Blast_Score=146, Evalue=3e-35,
Organism=Drosophila melanogaster, GI24662717, Length=375, Percent_Identity=31.2, Blast_Score=157, Evalue=2e-38,
Organism=Drosophila melanogaster, GI78706642, Length=375, Percent_Identity=31.2, Blast_Score=157, Evalue=2e-38,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 50754; Mature: 50754

Theoretical pI: Translated: 8.51; Mature: 8.51

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.9 %Cys     (Translated Protein)
2.4 %Met     (Translated Protein)
3.3 %Cys+Met (Translated Protein)
0.9 %Cys     (Mature Protein)
2.4 %Met     (Mature Protein)
3.3 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKSPSLSLKVCTAMLCGWAAIAQPGAKPLPAPKSQDERMAWFREAKFGLFIHWGLYSIPA
CCCCCCHHHHHHHHHHHHHHHHCCCCCCCCCCCCCHHHHHHHHHCCCCEEEEECCEECCC
GEWKGQPIAGIGEWIMNRAKIPVAEYEQLATRFNPVKFNAEEWVQMAQDAGMKYIVITSK
CCCCCCCCHHHHHHHHCCCCCCHHHHHHHHHHCCCEEECHHHHHHHHHHCCCEEEEEEEC
HHDGFAMYGSKVSKYNIVDATPFHRDPLKELSEACARHGLKFGFYYSQSQDWHEPGGMGN
CCCCEEEECCCCCEEEEEECCCCCCCHHHHHHHHHHHCCCEEEEEECCCCCCCCCCCCCC
TWDFGPDAAKEPIYDEYLRGKAEPQVKELLANYGPVALIWFDTARSMTGDRGPRFIDILR
CCCCCCCCCCCCHHHHHHCCCCCHHHHHHHHCCCCEEEEEEECCCCCCCCCCCHHHHHHH
TMQPATLIDGRLGVKGDYVSTGDNQIPNQVLHEDWEVPATLNKTWGFKKDDTDWKTPQDL
HCCCCCEECCCCCCCCCEECCCCCCCCHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCH
QFKLVDIVSKGGNYLLNVGPTSEGVIPQASQDNLRAVGKWLKVNGESVYGAGATPFGPEL
HEEEEEHHHCCCCEEEEECCCCCCCCCCCCCCHHHHHHHHHEECCCEEECCCCCCCCCCC
GEVDNTTKDKKGNPGFKIAKDWRCTTKPGKLYIHLFKYPAGSFELSKVSGKVQKAYLLAD
CCCCCCCCCCCCCCCCEEECCCEEECCCCEEEEEEEECCCCCEEHHHHHCCCEEEEEEEC
AKHSSLKLKQSGDTVTVTLPANAPDEMDSVLVLQTASK
CCCCCEEEEECCCEEEEEECCCCCCCCCCEEEEEECCC
>Mature Secondary Structure
MKSPSLSLKVCTAMLCGWAAIAQPGAKPLPAPKSQDERMAWFREAKFGLFIHWGLYSIPA
CCCCCCHHHHHHHHHHHHHHHHCCCCCCCCCCCCCHHHHHHHHHCCCCEEEEECCEECCC
GEWKGQPIAGIGEWIMNRAKIPVAEYEQLATRFNPVKFNAEEWVQMAQDAGMKYIVITSK
CCCCCCCCHHHHHHHHCCCCCCHHHHHHHHHHCCCEEECHHHHHHHHHHCCCEEEEEEEC
HHDGFAMYGSKVSKYNIVDATPFHRDPLKELSEACARHGLKFGFYYSQSQDWHEPGGMGN
CCCCEEEECCCCCEEEEEECCCCCCCHHHHHHHHHHHCCCEEEEEECCCCCCCCCCCCCC
TWDFGPDAAKEPIYDEYLRGKAEPQVKELLANYGPVALIWFDTARSMTGDRGPRFIDILR
CCCCCCCCCCCCHHHHHHCCCCCHHHHHHHHCCCCEEEEEEECCCCCCCCCCCHHHHHHH
TMQPATLIDGRLGVKGDYVSTGDNQIPNQVLHEDWEVPATLNKTWGFKKDDTDWKTPQDL
HCCCCCEECCCCCCCCCEECCCCCCCCHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCH
QFKLVDIVSKGGNYLLNVGPTSEGVIPQASQDNLRAVGKWLKVNGESVYGAGATPFGPEL
HEEEEEHHHCCCCEEEEECCCCCCCCCCCCCCHHHHHHHHHEECCCEEECCCCCCCCCCC
GEVDNTTKDKKGNPGFKIAKDWRCTTKPGKLYIHLFKYPAGSFELSKVSGKVQKAYLLAD
CCCCCCCCCCCCCCCCEEECCCEEECCCCEEEEEEEECCCCCEEHHHHHCCCEEEEEEEC
AKHSSLKLKQSGDTVTVTLPANAPDEMDSVLVLQTASK
CCCCCEEEEECCCEEEEEECCCCCCCCCCEEEEEECCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA