Definition Akkermansia muciniphila ATCC BAA-835, complete genome.
Accession NC_010655
Length 2,664,102

Click here to switch to the map view.

The map label for this gene is oatA [H]

Identifier: 187736576

GI number: 187736576

Start: 2550481

End: 2552529

Strand: Direct

Name: oatA [H]

Synonym: Amuc_2098

Alternate gene names: 187736576

Gene position: 2550481-2552529 (Clockwise)

Preceding gene: 187736575

Following gene: 187736577

Centisome position: 95.74

GC content: 53.54

Gene sequence:

>2049_bases
ATGAAGCAAATCACTTCACTCAGAGGCCTCGCGATTATTCTGATCATCCTTTTCCACCTCAATCCGGAGCATTTCCCCTA
CGGCTACTTCGGCGTTGAAGTGTTTCTGGTGATTTCCGGCTACCTGCTCATGAAGTCCCTCCAGAAACAGCAAATGCAAA
TCCGTCTCGGGGAATTTGCCCGTAAAAAAGTCTTAAGACTTTTTACCCCGGTTGCCGTCATCGTCCCGCTCACTCTTCTG
GCTGGCATGTTCCTTCTGGACTATACGGACCTGGCGACAGCCAGTTCCACAGGCGGATATACGCTGATAGGCGCCGCAAA
CAGGTTCCTGGCCGTCATCCAGTCCGACTATTTCGCGCAGGATTCTTCCGGCAATCCGTTCCTTCACATGTGGTACCTGG
CGGTGACGGTGCAGATTTATCTTTTGTTCGCGGGGGGATGCGTCCTGTACCGTTACCTTCCCAAACGGGCGGCCGCCTCT
CTTTTCTGGATCGCCGGCATCGGGTCCTTTCTCTGGGCCTATTCCTATCCCATTCACAACCTGTTGCAGGAAATCGGCCT
GCCCGTCTGGGAGCAGGTCCGCCCCACTTCCCATTACATGACGCTGCCCCGTTTGTGGGAGGTTTGCGCGGGGATTTTGT
TAGCAATATACCCCCCCCCCTTAAGTTCAACATGTTGCGAAAACAACAAGAAAAACGCTCTCCTCTTCCTCCTTGGAATG
TTATGCATCCTCGTACCTGCCCTTTCCCGCGGAAAGGATGTCTCCCTCTGCTCGGCGGCCGTAGTTTTGGGGACATGCCT
GGTGATCCGGTATGCGGAATCCGGCAGGCTAGCCCACTGGTTCAACAATAAACTTCTGCTGTGGATTGGAGGAATCTCGT
TCTCCCTTTACCTGGTGCATATGCCCCTCATCGCGTTCTATCATTCGTGGTTTCTCCATGCTCCCGGATGGCCCGGAATG
CTTGCCATCGGAGCGGCGTCCGCAGTCCTGGGAGGTCTCCTGTACCTTGCAGTAGAGAAAAAGCGCATGAAGATGAAATG
GTTTATCCCCTTGTACCTTTTCGCGTTGCTTCTATGCGTTGCAGGAAGGCAGACGGAAGGATTCCGGAACTACATCAACA
AGGAAATCAACTCCATTTCCAGCCCCCAGCTGCATGGCGCATCGGAAATCAAATCTCCTGAAGCCGCCCGGGGATTTGAT
AAGGAAGCCATCAAATTCAATAACAACATCTTTGCCTTCGTCAGCAGAGCCGATTTCAAAGGAAGTGCGGAACCCGGCCT
GCTGCAGCTGGGTTCCCCTGCCGAAGCTCCATCCATAGTCCTGCTGGGGGACAGCCACGCCTCTGCGGCCTTTTGCGGAT
TGGACGCAGCATGCAGGGAACTGGATATCTCCGGGATTTACGTTTCTTCCGTCATTTCCCCGTTCTGGAACAGGGAATTG
CCCGCGCTGCCGTTTGATGCAAGCTACTATTGCGACGAGAAAAAAATAAAGGCCCTCATGGCATGGCTGAACGTCCACCC
GGAAATCAGCCATGTGGTGATAGCCCAGCACTGGAGCACCCGTTACGACAGTAAAAATGTAATGGACTGGAAGCTGAAGC
CGCTTCCCTCCGGAGAACCTGCCTATTCAGATTCTCTCCGTGCGTTTATCTCCGAACTGCGGGCGATGGGCAAGCAAGTC
ATCCTGTTGGCCCCCACTCCGCTCATCAAGCAAAATGATGTGGCCAAATACATCAGGAACCTCATACGCAGGGGGGAAAC
GGGAAAAGGCCTGGAAAGCCTTACCTGCACGCGGCAAAAATACAGGGAAGATCATGCCGCCGTGCTTCCCATCCTTGACC
GTCTTGAACAGGAAGGGATCTGCACCGTCCTGCGCATACTTCCCTATATACCGGAAGACAGGCCGTTCAACGCCTATGAA
CACGGGGAAATCCTGTACAAGGATAGCGACCACATGTCCAGCAAAGGCTCCATCAAACTCTTCCAGCACCTGAAACCCCA
GTTAAAGGAAGCGCTACAAAAAGAATCCACGGCATCACCAGGTTCATAA

Upstream 100 bases:

>100_bases
CTGAGCGATTTGTTGAAGATTAAAAGCCAGAATCTTTTGAGGATCTTACAGCAACGCTATTCCGCATAATTCCGTTCATT
TATCTGCAATCCTGATCAAT

Downstream 100 bases:

>100_bases
AATCCGTAGCCGTGAACACGTCTGCCGCAGCTCCGGCAGGGAAACATTTAAATAAAACCGGCTTTTGTGGAAGCTATAGA
GTTTTCTTTGGGAAAAAAAT

Product: acyltransferase 3

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 682; Mature: 682

Protein sequence:

>682_residues
MKQITSLRGLAIILIILFHLNPEHFPYGYFGVEVFLVISGYLLMKSLQKQQMQIRLGEFARKKVLRLFTPVAVIVPLTLL
AGMFLLDYTDLATASSTGGYTLIGAANRFLAVIQSDYFAQDSSGNPFLHMWYLAVTVQIYLLFAGGCVLYRYLPKRAAAS
LFWIAGIGSFLWAYSYPIHNLLQEIGLPVWEQVRPTSHYMTLPRLWEVCAGILLAIYPPPLSSTCCENNKKNALLFLLGM
LCILVPALSRGKDVSLCSAAVVLGTCLVIRYAESGRLAHWFNNKLLLWIGGISFSLYLVHMPLIAFYHSWFLHAPGWPGM
LAIGAASAVLGGLLYLAVEKKRMKMKWFIPLYLFALLLCVAGRQTEGFRNYINKEINSISSPQLHGASEIKSPEAARGFD
KEAIKFNNNIFAFVSRADFKGSAEPGLLQLGSPAEAPSIVLLGDSHASAAFCGLDAACRELDISGIYVSSVISPFWNREL
PALPFDASYYCDEKKIKALMAWLNVHPEISHVVIAQHWSTRYDSKNVMDWKLKPLPSGEPAYSDSLRAFISELRAMGKQV
ILLAPTPLIKQNDVAKYIRNLIRRGETGKGLESLTCTRQKYREDHAAVLPILDRLEQEGICTVLRILPYIPEDRPFNAYE
HGEILYKDSDHMSSKGSIKLFQHLKPQLKEALQKESTASPGS

Sequences:

>Translated_682_residues
MKQITSLRGLAIILIILFHLNPEHFPYGYFGVEVFLVISGYLLMKSLQKQQMQIRLGEFARKKVLRLFTPVAVIVPLTLL
AGMFLLDYTDLATASSTGGYTLIGAANRFLAVIQSDYFAQDSSGNPFLHMWYLAVTVQIYLLFAGGCVLYRYLPKRAAAS
LFWIAGIGSFLWAYSYPIHNLLQEIGLPVWEQVRPTSHYMTLPRLWEVCAGILLAIYPPPLSSTCCENNKKNALLFLLGM
LCILVPALSRGKDVSLCSAAVVLGTCLVIRYAESGRLAHWFNNKLLLWIGGISFSLYLVHMPLIAFYHSWFLHAPGWPGM
LAIGAASAVLGGLLYLAVEKKRMKMKWFIPLYLFALLLCVAGRQTEGFRNYINKEINSISSPQLHGASEIKSPEAARGFD
KEAIKFNNNIFAFVSRADFKGSAEPGLLQLGSPAEAPSIVLLGDSHASAAFCGLDAACRELDISGIYVSSVISPFWNREL
PALPFDASYYCDEKKIKALMAWLNVHPEISHVVIAQHWSTRYDSKNVMDWKLKPLPSGEPAYSDSLRAFISELRAMGKQV
ILLAPTPLIKQNDVAKYIRNLIRRGETGKGLESLTCTRQKYREDHAAVLPILDRLEQEGICTVLRILPYIPEDRPFNAYE
HGEILYKDSDHMSSKGSIKLFQHLKPQLKEALQKESTASPGS
>Mature_682_residues
MKQITSLRGLAIILIILFHLNPEHFPYGYFGVEVFLVISGYLLMKSLQKQQMQIRLGEFARKKVLRLFTPVAVIVPLTLL
AGMFLLDYTDLATASSTGGYTLIGAANRFLAVIQSDYFAQDSSGNPFLHMWYLAVTVQIYLLFAGGCVLYRYLPKRAAAS
LFWIAGIGSFLWAYSYPIHNLLQEIGLPVWEQVRPTSHYMTLPRLWEVCAGILLAIYPPPLSSTCCENNKKNALLFLLGM
LCILVPALSRGKDVSLCSAAVVLGTCLVIRYAESGRLAHWFNNKLLLWIGGISFSLYLVHMPLIAFYHSWFLHAPGWPGM
LAIGAASAVLGGLLYLAVEKKRMKMKWFIPLYLFALLLCVAGRQTEGFRNYINKEINSISSPQLHGASEIKSPEAARGFD
KEAIKFNNNIFAFVSRADFKGSAEPGLLQLGSPAEAPSIVLLGDSHASAAFCGLDAACRELDISGIYVSSVISPFWNREL
PALPFDASYYCDEKKIKALMAWLNVHPEISHVVIAQHWSTRYDSKNVMDWKLKPLPSGEPAYSDSLRAFISELRAMGKQV
ILLAPTPLIKQNDVAKYIRNLIRRGETGKGLESLTCTRQKYREDHAAVLPILDRLEQEGICTVLRILPYIPEDRPFNAYE
HGEILYKDSDHMSSKGSIKLFQHLKPQLKEALQKESTASPGS

Specific function: Responsible for O-acetylation at the C(6)-hydroxyl group of N-acetylmuramyl residues, forming the corresponding N,6-O- diacetylmuramic acid of the peptidoglycan. O-acetylation of the peptidoglycan is the major determinant for lysozyme resistance [H]

COG id: COG1835

COG function: function code I; Predicted acyltransferases

Gene ontology:

Cell location: Cell membrane; Multi-pass membrane protein [H]

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Belongs to the acyltransferase 3 family [H]

Homologues:

Organism=Caenorhabditis elegans, GI17562856, Length=718, Percent_Identity=24.5125348189415, Blast_Score=113, Evalue=3e-25,
Organism=Caenorhabditis elegans, GI17540232, Length=370, Percent_Identity=27.2972972972973, Blast_Score=101, Evalue=1e-21,
Organism=Caenorhabditis elegans, GI71988046, Length=375, Percent_Identity=25.8666666666667, Blast_Score=99, Evalue=7e-21,
Organism=Caenorhabditis elegans, GI17507287, Length=503, Percent_Identity=25.2485089463221, Blast_Score=99, Evalue=9e-21,
Organism=Caenorhabditis elegans, GI17507283, Length=396, Percent_Identity=28.030303030303, Blast_Score=96, Evalue=4e-20,
Organism=Caenorhabditis elegans, GI17507167, Length=454, Percent_Identity=23.7885462555066, Blast_Score=95, Evalue=1e-19,
Organism=Caenorhabditis elegans, GI17562866, Length=386, Percent_Identity=27.979274611399, Blast_Score=93, Evalue=4e-19,
Organism=Caenorhabditis elegans, GI86562056, Length=337, Percent_Identity=28.7833827893175, Blast_Score=92, Evalue=7e-19,
Organism=Caenorhabditis elegans, GI71982248, Length=390, Percent_Identity=27.6923076923077, Blast_Score=91, Evalue=2e-18,
Organism=Caenorhabditis elegans, GI212640769, Length=367, Percent_Identity=26.158038147139, Blast_Score=89, Evalue=8e-18,
Organism=Caenorhabditis elegans, GI17562864, Length=367, Percent_Identity=28.6103542234332, Blast_Score=89, Evalue=9e-18,
Organism=Caenorhabditis elegans, GI17543924, Length=336, Percent_Identity=27.0833333333333, Blast_Score=88, Evalue=1e-17,
Organism=Caenorhabditis elegans, GI17506687, Length=365, Percent_Identity=25.2054794520548, Blast_Score=87, Evalue=2e-17,
Organism=Caenorhabditis elegans, GI17507735, Length=381, Percent_Identity=24.6719160104987, Blast_Score=87, Evalue=3e-17,
Organism=Caenorhabditis elegans, GI17532481, Length=356, Percent_Identity=26.4044943820225, Blast_Score=86, Evalue=6e-17,
Organism=Caenorhabditis elegans, GI17541014, Length=358, Percent_Identity=26.2569832402235, Blast_Score=86, Evalue=6e-17,
Organism=Caenorhabditis elegans, GI17541016, Length=358, Percent_Identity=26.2569832402235, Blast_Score=86, Evalue=6e-17,
Organism=Caenorhabditis elegans, GI71990417, Length=336, Percent_Identity=27.9761904761905, Blast_Score=86, Evalue=7e-17,
Organism=Caenorhabditis elegans, GI115534354, Length=416, Percent_Identity=25.2403846153846, Blast_Score=84, Evalue=3e-16,
Organism=Caenorhabditis elegans, GI17507733, Length=339, Percent_Identity=25.0737463126844, Blast_Score=84, Evalue=3e-16,
Organism=Caenorhabditis elegans, GI17559158, Length=308, Percent_Identity=25.3246753246753, Blast_Score=83, Evalue=4e-16,
Organism=Caenorhabditis elegans, GI212646204, Length=334, Percent_Identity=28.1437125748503, Blast_Score=82, Evalue=1e-15,
Organism=Caenorhabditis elegans, GI17542762, Length=378, Percent_Identity=24.0740740740741, Blast_Score=80, Evalue=3e-15,
Organism=Caenorhabditis elegans, GI17559544, Length=330, Percent_Identity=26.6666666666667, Blast_Score=80, Evalue=4e-15,
Organism=Caenorhabditis elegans, GI193208811, Length=340, Percent_Identity=25.2941176470588, Blast_Score=79, Evalue=9e-15,
Organism=Caenorhabditis elegans, GI17541414, Length=471, Percent_Identity=22.7176220806794, Blast_Score=77, Evalue=2e-14,
Organism=Caenorhabditis elegans, GI17541412, Length=453, Percent_Identity=23.1788079470199, Blast_Score=77, Evalue=3e-14,
Organism=Caenorhabditis elegans, GI17507299, Length=357, Percent_Identity=24.0896358543417, Blast_Score=77, Evalue=3e-14,
Organism=Caenorhabditis elegans, GI17507289, Length=357, Percent_Identity=24.0896358543417, Blast_Score=77, Evalue=3e-14,
Organism=Caenorhabditis elegans, GI32567150, Length=430, Percent_Identity=23.4883720930233, Blast_Score=73, Evalue=4e-13,
Organism=Caenorhabditis elegans, GI193208625, Length=355, Percent_Identity=24.2253521126761, Blast_Score=73, Evalue=6e-13,
Organism=Caenorhabditis elegans, GI71983744, Length=322, Percent_Identity=23.6024844720497, Blast_Score=72, Evalue=9e-13,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR002656
- InterPro:   IPR013830
- InterPro:   IPR013831 [H]

Pfam domain/function: PF01757 Acyl_transf_3 [H]

EC number: NA

Molecular weight: Translated: 76138; Mature: 76138

Theoretical pI: Translated: 8.97; Mature: 8.97

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.9 %Cys     (Translated Protein)
2.2 %Met     (Translated Protein)
4.1 %Cys+Met (Translated Protein)
1.9 %Cys     (Mature Protein)
2.2 %Met     (Mature Protein)
4.1 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKQITSLRGLAIILIILFHLNPEHFPYGYFGVEVFLVISGYLLMKSLQKQQMQIRLGEFA
CCCHHHHHHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
RKKVLRLFTPVAVIVPLTLLAGMFLLDYTDLATASSTGGYTLIGAANRFLAVIQSDYFAQ
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCEEEEECHHHHHHHHHHHHCCC
DSSGNPFLHMWYLAVTVQIYLLFAGGCVLYRYLPKRAAASLFWIAGIGSFLWAYSYPIHN
CCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHH
LLQEIGLPVWEQVRPTSHYMTLPRLWEVCAGILLAIYPPPLSSTCCENNKKNALLFLLGM
HHHHHCCCHHHHCCCCHHHEEHHHHHHHHHHHHEEECCCCCCHHHHCCCCCHHHHHHHHH
LCILVPALSRGKDVSLCSAAVVLGTCLVIRYAESGRLAHWFNNKLLLWIGGISFSLYLVH
HHHHHHHHCCCCCHHHHHHHHHHHHHHHHEECCCCCEEEEECCEEEEEECCHHHHHHHHH
MPLIAFYHSWFLHAPGWPGMLAIGAASAVLGGLLYLAVEKKRMKMKWFIPLYLFALLLCV
HHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHEEHHHHHHHHHHHH
AGRQTEGFRNYINKEINSISSPQLHGASEIKSPEAARGFDKEAIKFNNNIFAFVSRADFK
CCCCCHHHHHHHHHHHHCCCCCCCCCHHHCCCCHHHCCCCCHHEEECCCEEEEEEECCCC
GSAEPGLLQLGSPAEAPSIVLLGDSHASAAFCGLDAACRELDISGIYVSSVISPFWNREL
CCCCCCEEECCCCCCCCEEEEEECCCCCHHHHCHHHHHHHCCCCCEEHHHHHHHHHCCCC
PALPFDASYYCDEKKIKALMAWLNVHPEISHVVIAQHWSTRYDSKNVMDWKLKPLPSGEP
CCCCCCCCCCCCHHHHHHHHHHHHCCCCCCEEEEEHHHCCCCCCCCCCEEEECCCCCCCC
AYSDSLRAFISELRAMGKQVILLAPTPLIKQNDVAKYIRNLIRRGETGKGLESLTCTRQK
CHHHHHHHHHHHHHHCCCEEEEECCCCCCCCCHHHHHHHHHHHCCCCCCCHHHHHHHHHH
YREDHAAVLPILDRLEQEGICTVLRILPYIPEDRPFNAYEHGEILYKDSDHMSSKGSIKL
HHHHHHHHHHHHHHHCCCCHHHHHHHHCCCCCCCCCCCCCCCEEEEECCCCCCCCCCHHH
FQHLKPQLKEALQKESTASPGS
HHHCCHHHHHHHHHHCCCCCCC
>Mature Secondary Structure
MKQITSLRGLAIILIILFHLNPEHFPYGYFGVEVFLVISGYLLMKSLQKQQMQIRLGEFA
CCCHHHHHHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
RKKVLRLFTPVAVIVPLTLLAGMFLLDYTDLATASSTGGYTLIGAANRFLAVIQSDYFAQ
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCEEEEECHHHHHHHHHHHHCCC
DSSGNPFLHMWYLAVTVQIYLLFAGGCVLYRYLPKRAAASLFWIAGIGSFLWAYSYPIHN
CCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHH
LLQEIGLPVWEQVRPTSHYMTLPRLWEVCAGILLAIYPPPLSSTCCENNKKNALLFLLGM
HHHHHCCCHHHHCCCCHHHEEHHHHHHHHHHHHEEECCCCCCHHHHCCCCCHHHHHHHHH
LCILVPALSRGKDVSLCSAAVVLGTCLVIRYAESGRLAHWFNNKLLLWIGGISFSLYLVH
HHHHHHHHCCCCCHHHHHHHHHHHHHHHHEECCCCCEEEEECCEEEEEECCHHHHHHHHH
MPLIAFYHSWFLHAPGWPGMLAIGAASAVLGGLLYLAVEKKRMKMKWFIPLYLFALLLCV
HHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHEEHHHHHHHHHHHH
AGRQTEGFRNYINKEINSISSPQLHGASEIKSPEAARGFDKEAIKFNNNIFAFVSRADFK
CCCCCHHHHHHHHHHHHCCCCCCCCCHHHCCCCHHHCCCCCHHEEECCCEEEEEEECCCC
GSAEPGLLQLGSPAEAPSIVLLGDSHASAAFCGLDAACRELDISGIYVSSVISPFWNREL
CCCCCCEEECCCCCCCCEEEEEECCCCCHHHHCHHHHHHHCCCCCEEHHHHHHHHHCCCC
PALPFDASYYCDEKKIKALMAWLNVHPEISHVVIAQHWSTRYDSKNVMDWKLKPLPSGEP
CCCCCCCCCCCCHHHHHHHHHHHHCCCCCCEEEEEHHHCCCCCCCCCCEEEECCCCCCCC
AYSDSLRAFISELRAMGKQVILLAPTPLIKQNDVAKYIRNLIRRGETGKGLESLTCTRQK
CHHHHHHHHHHHHHHCCCEEEEECCCCCCCCCHHHHHHHHHHHCCCCCCCHHHHHHHHHH
YREDHAAVLPILDRLEQEGICTVLRILPYIPEDRPFNAYEHGEILYKDSDHMSSKGSIKL
HHHHHHHHHHHHHHHCCCCHHHHHHHHCCCCCCCCCCCCCCCEEEEECCCCCCCCCCHHH
FQHLKPQLKEALQKESTASPGS
HHHCCHHHHHHHHHHCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: NA