Definition Candidatus Solibacter usitatus Ellin6076 chromosome, complete genome.
Accession NC_008536
Length 9,965,640

Click here to switch to the map view.

The map label for this gene is 116621433

Identifier: 116621433

GI number: 116621433

Start: 2958717

End: 2961329

Strand: Direct

Name: 116621433

Synonym: Acid_2315

Alternate gene names: NA

Gene position: 2958717-2961329 (Clockwise)

Preceding gene: 116621432

Following gene: 116621436

Centisome position: 29.69

GC content: 66.48

Gene sequence:

>2613_bases
ATGCGTAATTTTGTCCTAACGTTGGTTCTTGGTGTATCTCTGCTCGCGCCCCTTCCTGCGCAGCGCAGTTTCTCGGGAGC
CGCCGAAATCGAGCAGTCGCTCCACAAGCTCAACGAATTGGGCACCGTCCTCCACATTGCCGCGCATCCCGATGACGAGC
GCACCGCCGTGCTGGCGTACTTCGCGCGCGGGCGCCACATGCGCACGGCTTACCTCTCCCTGACGCGCGGTGAAGGCGGC
CAGAACCTGATCGGCTCCGAACAGGGCGCGCAGCTCGGCATCATCCGCACCCAGGAACTGCTGGCCGCGCGCGAGATTGA
TGGCGCGGAGCAGTTCTTCACGCGCGCCATCGATTTCGGATTCACCCGCACGCCCGAGGAGACCATGCAGAAGTGGGGCC
ACGACCGCATTCTTGGCGACGTGGTCTGGGTCATCCGCCGCTACCGGCCCGACGTGATCTTCCTGGGCTTCAGCGGCACG
CCGCGCGACGGCCACGGCCAGCACCAGGCCTCGGCCATCCTTGGCAAAGAGGCGTTCACCGCCGCCGCCGATCCCACCAA
ATTTCCCGAGCAGTTGAAATACGTGAAGGTGTGGCAGGCCAAGCGCCTGCTCCAGGCCGCAGGCTTCGGCGGTGCGCCCG
GCGGACCGGGCGGTGGACGCGGCGGACGCGGCGGGGCAGCTCCCGCGCAGCCTGCCCCCGCCGTCCAGCCCGATGGCTTC
GAGGCCACCAACGGGCCGCAGGTGGATACCGGCGCCTTCAACCCGATCCTCGGCTACTCCTACGAGGAGCTGGCGGTGCT
CAGCCGCAGCATGCATCACAGCCAGGGCACCGGGGCCATGCGGCGTCCGGGGGCCGGACGCGCCGGCATGACCGTGATCG
GCGGCGCGCCCGCCACCAGGGATCTCTTCGATGGCATCGACACATCGTGGAACCGGCTGCCCGGCGGTGCACCGGTGAAG
GCGATCTTCGACGAAGTCATCCGCGATTACGAACCTGCTCATCCCGAGAAGGCGATCCCGCTGCTGCTCAAAGCGCGCCC
GCTGATCGCCGCGATCGACGACCCGCTCGCCCGGATCAAGCTCGCCGAACTTGATGAGGCCATCGCGCTCTGCGCCGGAC
TCTACGTGGAAGCGCAGGCCCGCCAGCCCGAAGTCACGCCCGGCGCCACGCTCAACATCAACACCACCGTGCTCAACCGG
TCCGCCGCGAAAGTGACGTTTGAAAGCGCCCGCATCGAGGGCATCTGGAACCAGGACGCGGCGGCCAAGCCGGCCACGCT
CGGCTACAACCAGAGCGCCGATATCGCGCTCAGTCTCGCGGTACCGCCCAACCAGCCCTACACGCAGCCTTACTGGCTGG
TGAAGCCGCCAACGGCCGACGTCTACCGGGTCGATGACCAGCAGCTCATCGGCCTGGCCGATACGCCCCCGGCCGCGCAG
ATGCGCATTCACCTGACGGTGGACGGCACGCCGATCGAGCTGGTGCGGCCGGTGCATCATCGTTACGCCGACCGCGCTTA
TGGAGAGCGCGTGCGCCCGCTGGAGGTGGTCCCCACGGTCGCCGTCAATCTACCCACGCCGGTAGCGGTCTTCCCGGATT
CCGCCGCGCGCAAAGTACAGGTTTCGGTACAGGCCCACGTGGCCAATGCCAGCGGCGAATTGCGCCTGGAAGCGCCGGCC
GGATGGAAGGTGGAGCCGCGCGCGCAGGCTTTCAAGATCGAAACTTCCGGCGAACAGCAGGTGCTCACCTTCCAGGTCAC
GCCGCCCGCCGGGGAAACCACGGCAGCGCTGCACGCCGTGGCCAACGCCGGCGGCCGCGATATCGCCTCCGGCACGCAGG
TCATCGCCCATCCGCACTTCCCGGCGCAGACGCTTTTTCCGCCGTCGGATATCAAGCTTGTGCGCGCCAATATCAAGATC
ACCGCGAAGAAAGTCGGCTACATCATGGGCGCCGGGGATGAGATGCCCGAAGCCCTCCGGCAGCTCGGCATCGACGTCAC
GCTGCTCACCCAGAGCGATCTGGAGCAGGGCGACCTCAGCCGCTTCGACGCCATCGTCGCCGGCGTCCGCGCCTACAACG
TGCGGTCCGATATTCGCGCAAACCAGCAGCGCCTGCTCGACTACGTCAAGAATGGCGGCACCTACGTGGTGCAATACCAG
ACCGGCGATAGTCCCGACCCCGCCGCGCCGCGCGGGCAGCAGCCGCCCAACCCCTTCAACCAGCAGCAGACCGCGCCCGT
CACCACGAATCTGGGTCCGTATCCTTTCTTTGTGCCTGGCGGCAACAAATACCGCATCACGGTGGAAGAGGCTCCGGTGA
AATTTCCCAACCAGGATAGCCCGCTGCTACAGTACCCGAATCACATCAATCCCAAGGATTTCGAGGGCTGGGTGCAGGAG
CGCGGCGTGTATTTCGCGGTGGGCTGGGACAAGCATTACGAGACCGTGCTGGCCTCGGAAGATCCCGGCGAGCCGCCGCT
TGAGGGCGGCTTGATCTGGACGCGCTACGGCAAGGGCGTCTATATCTTCACTTCGTATAGCTGGTTCCGCCAGTTACCGG
CCGGCGTCCCCGGCGCGTACCGTCTCTTCGCCAACTTGCTGAGCGCCAAGTAG

Upstream 100 bases:

>100_bases
CGAGCGAAGCTCGCTGCGGATCGGGATTTTTTCACGGCTCATGAAGAGCACACCGGTGCATCTTCAAGAAACCGCGGCGC
ATCGGATAAACTGGAAAAAC

Downstream 100 bases:

>100_bases
GACGGACCTCCTGGCCCGTCCCCTTTGATTAGTTGTTTGAAGACAGGCGCTTCCTCCGCAGTTGTAGCGCCTGTTTCGCT
TTTTTGATCCAAACCCAGCT

Product: LmbE family protein

Products: NA

Alternate protein names: GlcNAc-PI De-N-Acetylase Family Protein; GlcNAc-PI De-N-Acetylase Family; Lmbe Family Protein; Secreted Protein; N-Acetylglucosaminylphosphatidylinositoldeacetylase; LmbE-Like Protein

Number of amino acids: Translated: 870; Mature: 870

Protein sequence:

>870_residues
MRNFVLTLVLGVSLLAPLPAQRSFSGAAEIEQSLHKLNELGTVLHIAAHPDDERTAVLAYFARGRHMRTAYLSLTRGEGG
QNLIGSEQGAQLGIIRTQELLAAREIDGAEQFFTRAIDFGFTRTPEETMQKWGHDRILGDVVWVIRRYRPDVIFLGFSGT
PRDGHGQHQASAILGKEAFTAAADPTKFPEQLKYVKVWQAKRLLQAAGFGGAPGGPGGGRGGRGGAAPAQPAPAVQPDGF
EATNGPQVDTGAFNPILGYSYEELAVLSRSMHHSQGTGAMRRPGAGRAGMTVIGGAPATRDLFDGIDTSWNRLPGGAPVK
AIFDEVIRDYEPAHPEKAIPLLLKARPLIAAIDDPLARIKLAELDEAIALCAGLYVEAQARQPEVTPGATLNINTTVLNR
SAAKVTFESARIEGIWNQDAAAKPATLGYNQSADIALSLAVPPNQPYTQPYWLVKPPTADVYRVDDQQLIGLADTPPAAQ
MRIHLTVDGTPIELVRPVHHRYADRAYGERVRPLEVVPTVAVNLPTPVAVFPDSAARKVQVSVQAHVANASGELRLEAPA
GWKVEPRAQAFKIETSGEQQVLTFQVTPPAGETTAALHAVANAGGRDIASGTQVIAHPHFPAQTLFPPSDIKLVRANIKI
TAKKVGYIMGAGDEMPEALRQLGIDVTLLTQSDLEQGDLSRFDAIVAGVRAYNVRSDIRANQQRLLDYVKNGGTYVVQYQ
TGDSPDPAAPRGQQPPNPFNQQQTAPVTTNLGPYPFFVPGGNKYRITVEEAPVKFPNQDSPLLQYPNHINPKDFEGWVQE
RGVYFAVGWDKHYETVLASEDPGEPPLEGGLIWTRYGKGVYIFTSYSWFRQLPAGVPGAYRLFANLLSAK

Sequences:

>Translated_870_residues
MRNFVLTLVLGVSLLAPLPAQRSFSGAAEIEQSLHKLNELGTVLHIAAHPDDERTAVLAYFARGRHMRTAYLSLTRGEGG
QNLIGSEQGAQLGIIRTQELLAAREIDGAEQFFTRAIDFGFTRTPEETMQKWGHDRILGDVVWVIRRYRPDVIFLGFSGT
PRDGHGQHQASAILGKEAFTAAADPTKFPEQLKYVKVWQAKRLLQAAGFGGAPGGPGGGRGGRGGAAPAQPAPAVQPDGF
EATNGPQVDTGAFNPILGYSYEELAVLSRSMHHSQGTGAMRRPGAGRAGMTVIGGAPATRDLFDGIDTSWNRLPGGAPVK
AIFDEVIRDYEPAHPEKAIPLLLKARPLIAAIDDPLARIKLAELDEAIALCAGLYVEAQARQPEVTPGATLNINTTVLNR
SAAKVTFESARIEGIWNQDAAAKPATLGYNQSADIALSLAVPPNQPYTQPYWLVKPPTADVYRVDDQQLIGLADTPPAAQ
MRIHLTVDGTPIELVRPVHHRYADRAYGERVRPLEVVPTVAVNLPTPVAVFPDSAARKVQVSVQAHVANASGELRLEAPA
GWKVEPRAQAFKIETSGEQQVLTFQVTPPAGETTAALHAVANAGGRDIASGTQVIAHPHFPAQTLFPPSDIKLVRANIKI
TAKKVGYIMGAGDEMPEALRQLGIDVTLLTQSDLEQGDLSRFDAIVAGVRAYNVRSDIRANQQRLLDYVKNGGTYVVQYQ
TGDSPDPAAPRGQQPPNPFNQQQTAPVTTNLGPYPFFVPGGNKYRITVEEAPVKFPNQDSPLLQYPNHINPKDFEGWVQE
RGVYFAVGWDKHYETVLASEDPGEPPLEGGLIWTRYGKGVYIFTSYSWFRQLPAGVPGAYRLFANLLSAK
>Mature_870_residues
MRNFVLTLVLGVSLLAPLPAQRSFSGAAEIEQSLHKLNELGTVLHIAAHPDDERTAVLAYFARGRHMRTAYLSLTRGEGG
QNLIGSEQGAQLGIIRTQELLAAREIDGAEQFFTRAIDFGFTRTPEETMQKWGHDRILGDVVWVIRRYRPDVIFLGFSGT
PRDGHGQHQASAILGKEAFTAAADPTKFPEQLKYVKVWQAKRLLQAAGFGGAPGGPGGGRGGRGGAAPAQPAPAVQPDGF
EATNGPQVDTGAFNPILGYSYEELAVLSRSMHHSQGTGAMRRPGAGRAGMTVIGGAPATRDLFDGIDTSWNRLPGGAPVK
AIFDEVIRDYEPAHPEKAIPLLLKARPLIAAIDDPLARIKLAELDEAIALCAGLYVEAQARQPEVTPGATLNINTTVLNR
SAAKVTFESARIEGIWNQDAAAKPATLGYNQSADIALSLAVPPNQPYTQPYWLVKPPTADVYRVDDQQLIGLADTPPAAQ
MRIHLTVDGTPIELVRPVHHRYADRAYGERVRPLEVVPTVAVNLPTPVAVFPDSAARKVQVSVQAHVANASGELRLEAPA
GWKVEPRAQAFKIETSGEQQVLTFQVTPPAGETTAALHAVANAGGRDIASGTQVIAHPHFPAQTLFPPSDIKLVRANIKI
TAKKVGYIMGAGDEMPEALRQLGIDVTLLTQSDLEQGDLSRFDAIVAGVRAYNVRSDIRANQQRLLDYVKNGGTYVVQYQ
TGDSPDPAAPRGQQPPNPFNQQQTAPVTTNLGPYPFFVPGGNKYRITVEEAPVKFPNQDSPLLQYPNHINPKDFEGWVQE
RGVYFAVGWDKHYETVLASEDPGEPPLEGGLIWTRYGKGVYIFTSYSWFRQLPAGVPGAYRLFANLLSAK

Specific function: Unknown

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 94139; Mature: 94139

Theoretical pI: Translated: 6.95; Mature: 6.95

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.1 %Cys     (Translated Protein)
1.0 %Met     (Translated Protein)
1.1 %Cys+Met (Translated Protein)
0.1 %Cys     (Mature Protein)
1.0 %Met     (Mature Protein)
1.1 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MRNFVLTLVLGVSLLAPLPAQRSFSGAAEIEQSLHKLNELGTVLHIAAHPDDERTAVLAY
CCCHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHCCEEEEEEECCCCCCCEEEEE
FARGRHMRTAYLSLTRGEGGQNLIGSEQGAQLGIIRTQELLAAREIDGAEQFFTRAIDFG
HHCCCEEEEEEEEEECCCCCCCCCCCCCCCEEEEEEHHHHHHHHHCCCHHHHHHHHHHCC
FTRTPEETMQKWGHDRILGDVVWVIRRYRPDVIFLGFSGTPRDGHGQHQASAILGKEAFT
CCCCCHHHHHHCCCHHHHHHHHHHHHHCCCCEEEEECCCCCCCCCCCHHHHHHHHHHHHC
AAADPTKFPEQLKYVKVWQAKRLLQAAGFGGAPGGPGGGRGGRGGAAPAQPAPAVQPDGF
CCCCCCCCHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC
EATNGPQVDTGAFNPILGYSYEELAVLSRSMHHSQGTGAMRRPGAGRAGMTVIGGAPATR
CCCCCCCCCCCCCCCHHCCCHHHHHHHHHHHHCCCCCCCCCCCCCCCCCEEEECCCCCHH
DLFDGIDTSWNRLPGGAPVKAIFDEVIRDYEPAHPEKAIPLLLKARPLIAAIDDPLARIK
HHHHCCCCCHHCCCCCCCHHHHHHHHHHHCCCCCCCCCCCEEEECCCEEEECCCHHHHEE
LAELDEAIALCAGLYVEAQARQPEVTPGATLNINTTVLNRSAAKVTFESARIEGIWNQDA
HHHHHHHHHHHHHHEEEECCCCCCCCCCCEEEEEHHEECCCCCEEEEECEEEEEEECCCC
AAKPATLGYNQSADIALSLAVPPNQPYTQPYWLVKPPTADVYRVDDQQLIGLADTPPAAQ
CCCCCCCCCCCCCCEEEEEECCCCCCCCCCEEEECCCCCCEEECCCCCEEEECCCCCCCE
MRIHLTVDGTPIELVRPVHHRYADRAYGERVRPLEVVPTVAVNLPTPVAVFPDSAARKVQ
EEEEEEECCCCHHHHHHHHHHHHHHHHHCCCCCEEEECEEEEECCCCEEECCCCCCEEEE
VSVQAHVANASGELRLEAPAGWKVEPRAQAFKIETSGEQQVLTFQVTPPAGETTAALHAV
EEEEEEEECCCCCEEEECCCCCEECCCCEEEEEECCCCCEEEEEEECCCCCCHHHHHHHH
ANAGGRDIASGTQVIAHPHFPAQTLFPPSDIKLVRANIKITAKKVGYIMGAGDEMPEALR
HCCCCCCCCCCCEEEECCCCCCCCCCCCCCCEEEEECEEEEEEEEEEEEECCCHHHHHHH
QLGIDVTLLTQSDLEQGDLSRFDAIVAGVRAYNVRSDIRANQQRLLDYVKNGGTYVVQYQ
HHCCCEEEEECCCCCCCCHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHCCCEEEEEEC
TGDSPDPAAPRGQQPPNPFNQQQTAPVTTNLGPYPFFVPGGNKYRITVEEAPVKFPNQDS
CCCCCCCCCCCCCCCCCCCCCCCCCCEECCCCCCEEECCCCCEEEEEEECCCCCCCCCCC
PLLQYPNHINPKDFEGWVQERGVYFAVGWDKHYETVLASEDPGEPPLEGGLIWTRYGKGV
CCEECCCCCCCCCHHHHHHHCCEEEEEECCCCCCEEEECCCCCCCCCCCCEEEEEECCEE
YIFTSYSWFRQLPAGVPGAYRLFANLLSAK
EEEECHHHHHHCCCCCCHHHHHHHHHHHCC
>Mature Secondary Structure
MRNFVLTLVLGVSLLAPLPAQRSFSGAAEIEQSLHKLNELGTVLHIAAHPDDERTAVLAY
CCCHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHCCEEEEEEECCCCCCCEEEEE
FARGRHMRTAYLSLTRGEGGQNLIGSEQGAQLGIIRTQELLAAREIDGAEQFFTRAIDFG
HHCCCEEEEEEEEEECCCCCCCCCCCCCCCEEEEEEHHHHHHHHHCCCHHHHHHHHHHCC
FTRTPEETMQKWGHDRILGDVVWVIRRYRPDVIFLGFSGTPRDGHGQHQASAILGKEAFT
CCCCCHHHHHHCCCHHHHHHHHHHHHHCCCCEEEEECCCCCCCCCCCHHHHHHHHHHHHC
AAADPTKFPEQLKYVKVWQAKRLLQAAGFGGAPGGPGGGRGGRGGAAPAQPAPAVQPDGF
CCCCCCCCHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC
EATNGPQVDTGAFNPILGYSYEELAVLSRSMHHSQGTGAMRRPGAGRAGMTVIGGAPATR
CCCCCCCCCCCCCCCHHCCCHHHHHHHHHHHHCCCCCCCCCCCCCCCCCEEEECCCCCHH
DLFDGIDTSWNRLPGGAPVKAIFDEVIRDYEPAHPEKAIPLLLKARPLIAAIDDPLARIK
HHHHCCCCCHHCCCCCCCHHHHHHHHHHHCCCCCCCCCCCEEEECCCEEEECCCHHHHEE
LAELDEAIALCAGLYVEAQARQPEVTPGATLNINTTVLNRSAAKVTFESARIEGIWNQDA
HHHHHHHHHHHHHHEEEECCCCCCCCCCCEEEEEHHEECCCCCEEEEECEEEEEEECCCC
AAKPATLGYNQSADIALSLAVPPNQPYTQPYWLVKPPTADVYRVDDQQLIGLADTPPAAQ
CCCCCCCCCCCCCCEEEEEECCCCCCCCCCEEEECCCCCCEEECCCCCEEEECCCCCCCE
MRIHLTVDGTPIELVRPVHHRYADRAYGERVRPLEVVPTVAVNLPTPVAVFPDSAARKVQ
EEEEEEECCCCHHHHHHHHHHHHHHHHHCCCCCEEEECEEEEECCCCEEECCCCCCEEEE
VSVQAHVANASGELRLEAPAGWKVEPRAQAFKIETSGEQQVLTFQVTPPAGETTAALHAV
EEEEEEEECCCCCEEEECCCCCEECCCCEEEEEECCCCCEEEEEEECCCCCCHHHHHHHH
ANAGGRDIASGTQVIAHPHFPAQTLFPPSDIKLVRANIKITAKKVGYIMGAGDEMPEALR
HCCCCCCCCCCCEEEECCCCCCCCCCCCCCCEEEEECEEEEEEEEEEEEECCCHHHHHHH
QLGIDVTLLTQSDLEQGDLSRFDAIVAGVRAYNVRSDIRANQQRLLDYVKNGGTYVVQYQ
HHCCCEEEEECCCCCCCCHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHCCCEEEEEEC
TGDSPDPAAPRGQQPPNPFNQQQTAPVTTNLGPYPFFVPGGNKYRITVEEAPVKFPNQDS
CCCCCCCCCCCCCCCCCCCCCCCCCCEECCCCCCEEECCCCCEEEEEEECCCCCCCCCCC
PLLQYPNHINPKDFEGWVQERGVYFAVGWDKHYETVLASEDPGEPPLEGGLIWTRYGKGV
CCEECCCCCCCCCHHHHHHHCCEEEEEECCCCCCEEEECCCCCCCCCCCCEEEEEECCEE
YIFTSYSWFRQLPAGVPGAYRLFANLLSAK
EEEECHHHHHHCCCCCCHHHHHHHHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA