Definition Akkermansia muciniphila ATCC BAA-835, complete genome.
Accession NC_010655
Length 2,664,102

Click here to switch to the map view.

The map label for this gene is 187736590

Identifier: 187736590

GI number: 187736590

Start: 2571886

End: 2574795

Strand: Direct

Name: 187736590

Synonym: Amuc_2112

Alternate gene names: NA

Gene position: 2571886-2574795 (Clockwise)

Preceding gene: 187736589

Following gene: 187736591

Centisome position: 96.54

GC content: 58.11

Gene sequence:

>2910_bases
ATGACAATCCCTCCTCCCCCTGCCCTGCCGCCCCATTTCAACATAGGCGGCTACAAAATCACGGCGCTTGTAGAAAGCGG
TCCGGACTATCATCTGTACCAGGCTCTTTCCCCGGAAGGCCATGCCGTCCTGATACGCGAATTCTGCCCCCGGGGCCTCG
TTACGCGTGACCTGGCCAGCGGAGAACTGGCTGTCTCTCCGGAAAATGAATCCCAATTCGCCCAGGCCCGGGAAGCTTTT
GAAACCCAATACGCAGCCAATGCAGAAGGCAAGCTGAGGGGATTCGGCACCGTGCTCTTCCTTTACCCGCTTTCTCCGGC
GCAGCCCCAGCCGGCTGCAGCGCATGCCCAGGCTCTCCGCCCCGCAAAAAAACCGCAGCAACCGCAACTGCGGAAACCCG
TAGTCGGCGCCGCCATCCCCGGAACGCCGCTGCCGCGGGTAAAGCACTCCGGAGGGTTTCCGGTCATCCCGGTCATTGTG
ACCGGGATGCTCGCCCTCTTCGGATTTCTGGGCTACCAGATACTCAAGGATAAAGAAGAACCCGTCGCTAAAGCCGTTAC
CGTGCCCGTACCGGCTCCGCCCAAACCCAAACCCAAGCCCGCTCCGCCAAAACCGGAGCCCGTGGTGGTCACTCCTGAAC
CGGAACCCGTGGTGGTCGCTCCCGAACCGGAACCGGAGCCTGAACCGGAGCCGCCTGCTCCCGACCTTTCCCCCTCCCCG
GAAGTCATTGCCATGGAAAAGGCTTTACGGGAGGAAGCTATCGCGTCCAAAGGGAAATTTTCTGAAAAACTGTTGAATAA
ATATCCCCATTACGCGGAAGCCTACGTACGGGATTACGTGAAAAAACGCGGAGGCAGTTTTTCTCCGGATTTTGAAAAAT
GGCTGAAAAACACGAAAAACAATCGTGAAGTCTTCGCCATGTTCTTCCCGCCGGACCCCAGCGTCGCCACCAATGTGGCT
TTCATGATTGATGAACTGGGGCTGGAAACAACGGAAAAATATGACCAGCTCGTTCTGGCGTTCGCAGTAGGACGCCGCGA
ATTCGGCATGGGAGCCTTCGACCTTACCCATCAGGGCCGTTACGTTGATGCCCTGGGCAAGCTGAATGATCTGAGATCCT
CCGGAGTCATGCCTCCGCCAGCGGACCTGTACTGCGCCGGGAAACCGCCCGTCAACTGGTATGGGAACGCCCCCCGCACC
GTGGATGAGGAATGCTACAAAAAGGTGGAAGCCTATCTGGACCGCAAAAAAATTACCCCCAAGCAGGCCTGGCTCAGGAA
ATACCCCACCGTCTCGGAAATTGGGGACTCCGCCATTACGGAAGACAACCTGGCCGGCTTTCTGCACGAATACATGTACC
GCCACGGCCAGCTGAGGCGCAAGAGGGATCCCTTCCCCACTCCGGTGGAATTCTTTTCCTACCTGGTGGATAAATATGAA
CATTGCGGTGATTTGCGCGACGTGGACCGCAAGCGTGTGGAATGGACCGGCGTCTCCCTGGAAGGAACGCCCTGGCCGGC
CATGATGGCCCTTTCGGAAACGCGCCCTCTGCGTGAGTGCGACAGCGTGTGGGAACGCTACATGGGCCAGCGGGGCCCGA
CCCGCCTGTGGCTGTACGGCCCCTACCGGGCGGATGACGATAAGGAACCGCCCATCCTGTTCAGCTTTGACCCGGATCCG
GAATGGTCCAGGGAATCCAATGAACGCAAGCTCCATGAAGGCGGCGTGTGCGGCACCATGTCCCTTATCTCCCGCAATTC
CCAGATCGCGCGCGGCATTCCCGCCGCCCCCGCCGGGCAGCCTGGCCACGGCAACCTGATGACCACCCATTTCACCGGCA
ACGGCTGCTGGCTGAGCGTGGGACAAAGTGTGGACACCCTGAAAGCCACCACGGGATTCTGGTACTTCCGGGATTCCAAC
GCACCGCGCACTGGCAATGCGGAATACCAGTCTGGACTGGCCCTGTCCATGAATATCGACTATGAAAAGTTCATCGACAG
CCGATTCGCCATGAACATTTACAAACTGGCGGCCACCGGCTCCTCCACGGAAGAGACGGCCGACCCTTCCGCCACGCTCC
CCAAGGAATTCACGCAGACCGCCATGAGGACCGTGCTCAAGGCCAACCCGTTCTACACGGAAGCCTGGTACACGCTCTTC
AAGCAGGAACCCCAGGACCTCATGGGAGCCACCAAGATGGTGGATGAAGTGAGGGAGGCCCTGCCGGACGGCATGGGCAT
CAGAAAACTCTGGAAAACGCGCAAATACGTTTCCTCCGTAGGCCGCGGCGACAAAAACGGCAAGGACATGCTGGCCAACC
ATGCCAGGGAATACGTCAATGTGCTCTGCTCCGTGATTCTGGAAAATGCCCTGAAACAGGAATATGACTATAAGACCTTC
CAGTGGGCCGAACTCATGTCCTGGCTCAAGTCTGAATCCAAACGCAACTCCTACCCGGAGCCTCAGGCCGCCTATCAGAT
AGCGTATGCCAAGGCCCAGGGCACGGACAGGCTCAAAAGAACCGTAGACAGGGGATTCAAGAAAGCCCTCAATTTCTACC
GGGACGACAGCAACGCCCTGAAGGAACCCAAGGATGTGGATCAGGAGGAAATGTCCTTTTCCCTGGCCGCCCTGTGCCAG
GCCCTGCCCAAGGAAGAACTGATCCCCTGGATGAAAAACATGCTGGACACCTGTCCGGACGGGTTCAAATACAAGCCCAA
AAATAAGAAGGAAACGAAAATCCACCCCTTCTACGACGCCCTGACGAAAAACTACATGTCTCTGGCTGACGGTTCGGAAA
AATCCCGCGTCAAGTCGGAAATGAAAGAGGCTTCCGACAGAATTCTGGAGCTTTCCCAGGACAAGAAAGGCGATGGGAAT
GGGTCCTCCGGACGCCGCCGGAGACGCTGA

Upstream 100 bases:

>100_bases
ATAACTGCTCCCGTTTCATGGCGCAGCTTCCTCACTCCGGCATTGACAAACGGCTCCGAACCTTTTTGAATATACGGGAT
CTTTGACCTCTTGATTCGTC

Downstream 100 bases:

>100_bases
TTCCCCGCTTCCGTGCACCTCTACGTCCACATTCCTTTCTGCCACCGTATTTGCCCGTACTGCGCTTTCTTCAAGCACAC
GCCGGCCTCCACGGACATGA

Product: hypothetical protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 969; Mature: 968

Protein sequence:

>969_residues
MTIPPPPALPPHFNIGGYKITALVESGPDYHLYQALSPEGHAVLIREFCPRGLVTRDLASGELAVSPENESQFAQAREAF
ETQYAANAEGKLRGFGTVLFLYPLSPAQPQPAAAHAQALRPAKKPQQPQLRKPVVGAAIPGTPLPRVKHSGGFPVIPVIV
TGMLALFGFLGYQILKDKEEPVAKAVTVPVPAPPKPKPKPAPPKPEPVVVTPEPEPVVVAPEPEPEPEPEPPAPDLSPSP
EVIAMEKALREEAIASKGKFSEKLLNKYPHYAEAYVRDYVKKRGGSFSPDFEKWLKNTKNNREVFAMFFPPDPSVATNVA
FMIDELGLETTEKYDQLVLAFAVGRREFGMGAFDLTHQGRYVDALGKLNDLRSSGVMPPPADLYCAGKPPVNWYGNAPRT
VDEECYKKVEAYLDRKKITPKQAWLRKYPTVSEIGDSAITEDNLAGFLHEYMYRHGQLRRKRDPFPTPVEFFSYLVDKYE
HCGDLRDVDRKRVEWTGVSLEGTPWPAMMALSETRPLRECDSVWERYMGQRGPTRLWLYGPYRADDDKEPPILFSFDPDP
EWSRESNERKLHEGGVCGTMSLISRNSQIARGIPAAPAGQPGHGNLMTTHFTGNGCWLSVGQSVDTLKATTGFWYFRDSN
APRTGNAEYQSGLALSMNIDYEKFIDSRFAMNIYKLAATGSSTEETADPSATLPKEFTQTAMRTVLKANPFYTEAWYTLF
KQEPQDLMGATKMVDEVREALPDGMGIRKLWKTRKYVSSVGRGDKNGKDMLANHAREYVNVLCSVILENALKQEYDYKTF
QWAELMSWLKSESKRNSYPEPQAAYQIAYAKAQGTDRLKRTVDRGFKKALNFYRDDSNALKEPKDVDQEEMSFSLAALCQ
ALPKEELIPWMKNMLDTCPDGFKYKPKNKKETKIHPFYDALTKNYMSLADGSEKSRVKSEMKEASDRILELSQDKKGDGN
GSSGRRRRR

Sequences:

>Translated_969_residues
MTIPPPPALPPHFNIGGYKITALVESGPDYHLYQALSPEGHAVLIREFCPRGLVTRDLASGELAVSPENESQFAQAREAF
ETQYAANAEGKLRGFGTVLFLYPLSPAQPQPAAAHAQALRPAKKPQQPQLRKPVVGAAIPGTPLPRVKHSGGFPVIPVIV
TGMLALFGFLGYQILKDKEEPVAKAVTVPVPAPPKPKPKPAPPKPEPVVVTPEPEPVVVAPEPEPEPEPEPPAPDLSPSP
EVIAMEKALREEAIASKGKFSEKLLNKYPHYAEAYVRDYVKKRGGSFSPDFEKWLKNTKNNREVFAMFFPPDPSVATNVA
FMIDELGLETTEKYDQLVLAFAVGRREFGMGAFDLTHQGRYVDALGKLNDLRSSGVMPPPADLYCAGKPPVNWYGNAPRT
VDEECYKKVEAYLDRKKITPKQAWLRKYPTVSEIGDSAITEDNLAGFLHEYMYRHGQLRRKRDPFPTPVEFFSYLVDKYE
HCGDLRDVDRKRVEWTGVSLEGTPWPAMMALSETRPLRECDSVWERYMGQRGPTRLWLYGPYRADDDKEPPILFSFDPDP
EWSRESNERKLHEGGVCGTMSLISRNSQIARGIPAAPAGQPGHGNLMTTHFTGNGCWLSVGQSVDTLKATTGFWYFRDSN
APRTGNAEYQSGLALSMNIDYEKFIDSRFAMNIYKLAATGSSTEETADPSATLPKEFTQTAMRTVLKANPFYTEAWYTLF
KQEPQDLMGATKMVDEVREALPDGMGIRKLWKTRKYVSSVGRGDKNGKDMLANHAREYVNVLCSVILENALKQEYDYKTF
QWAELMSWLKSESKRNSYPEPQAAYQIAYAKAQGTDRLKRTVDRGFKKALNFYRDDSNALKEPKDVDQEEMSFSLAALCQ
ALPKEELIPWMKNMLDTCPDGFKYKPKNKKETKIHPFYDALTKNYMSLADGSEKSRVKSEMKEASDRILELSQDKKGDGN
GSSGRRRRR
>Mature_968_residues
TIPPPPALPPHFNIGGYKITALVESGPDYHLYQALSPEGHAVLIREFCPRGLVTRDLASGELAVSPENESQFAQAREAFE
TQYAANAEGKLRGFGTVLFLYPLSPAQPQPAAAHAQALRPAKKPQQPQLRKPVVGAAIPGTPLPRVKHSGGFPVIPVIVT
GMLALFGFLGYQILKDKEEPVAKAVTVPVPAPPKPKPKPAPPKPEPVVVTPEPEPVVVAPEPEPEPEPEPPAPDLSPSPE
VIAMEKALREEAIASKGKFSEKLLNKYPHYAEAYVRDYVKKRGGSFSPDFEKWLKNTKNNREVFAMFFPPDPSVATNVAF
MIDELGLETTEKYDQLVLAFAVGRREFGMGAFDLTHQGRYVDALGKLNDLRSSGVMPPPADLYCAGKPPVNWYGNAPRTV
DEECYKKVEAYLDRKKITPKQAWLRKYPTVSEIGDSAITEDNLAGFLHEYMYRHGQLRRKRDPFPTPVEFFSYLVDKYEH
CGDLRDVDRKRVEWTGVSLEGTPWPAMMALSETRPLRECDSVWERYMGQRGPTRLWLYGPYRADDDKEPPILFSFDPDPE
WSRESNERKLHEGGVCGTMSLISRNSQIARGIPAAPAGQPGHGNLMTTHFTGNGCWLSVGQSVDTLKATTGFWYFRDSNA
PRTGNAEYQSGLALSMNIDYEKFIDSRFAMNIYKLAATGSSTEETADPSATLPKEFTQTAMRTVLKANPFYTEAWYTLFK
QEPQDLMGATKMVDEVREALPDGMGIRKLWKTRKYVSSVGRGDKNGKDMLANHAREYVNVLCSVILENALKQEYDYKTFQ
WAELMSWLKSESKRNSYPEPQAAYQIAYAKAQGTDRLKRTVDRGFKKALNFYRDDSNALKEPKDVDQEEMSFSLAALCQA
LPKEELIPWMKNMLDTCPDGFKYKPKNKKETKIHPFYDALTKNYMSLADGSEKSRVKSEMKEASDRILELSQDKKGDGNG
SSGRRRRR

Specific function: Unknown

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 108702; Mature: 108570

Theoretical pI: Translated: 8.20; Mature: 8.20

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.0 %Cys     (Translated Protein)
2.7 %Met     (Translated Protein)
3.7 %Cys+Met (Translated Protein)
1.0 %Cys     (Mature Protein)
2.6 %Met     (Mature Protein)
3.6 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MTIPPPPALPPHFNIGGYKITALVESGPDYHLYQALSPEGHAVLIREFCPRGLVTRDLAS
CCCCCCCCCCCCCCCCCEEEEEEEECCCCEEEEEECCCCCCEEEHHHHCCCCCCCHHCCC
GELAVSPENESQFAQAREAFETQYAANAEGKLRGFGTVLFLYPLSPAQPQPAAAHAQALR
CCEEECCCCHHHHHHHHHHHHHHHHCCCCCCEEECEEEEEEEECCCCCCCCHHHHHHHHC
PAKKPQQPQLRKPVVGAAIPGTPLPRVKHSGGFPVIPVIVTGMLALFGFLGYQILKDKEE
CCCCCCCCCHHCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCC
PVAKAVTVPVPAPPKPKPKPAPPKPEPVVVTPEPEPVVVAPEPEPEPEPEPPAPDLSPSP
HHHHEEEECCCCCCCCCCCCCCCCCCCEEECCCCCCEEECCCCCCCCCCCCCCCCCCCCC
EVIAMEKALREEAIASKGKFSEKLLNKYPHYAEAYVRDYVKKRGGSFSPDFEKWLKNTKN
CHHHHHHHHHHHHHHHCCCHHHHHHHHCCHHHHHHHHHHHHHCCCCCCCHHHHHHHCCCC
NREVFAMFFPPDPSVATNVAFMIDELGLETTEKYDQLVLAFAVGRREFGMGAFDLTHQGR
CCEEEEEEECCCCCHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHCCCCEECCCCCC
YVDALGKLNDLRSSGVMPPPADLYCAGKPPVNWYGNAPRTVDEECYKKVEAYLDRKKITP
HHHHHHHHHHHHHCCCCCCCCCEEECCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHCCCH
KQAWLRKYPTVSEIGDSAITEDNLAGFLHEYMYRHGQLRRKRDPFPTPVEFFSYLVDKYE
HHHHHHHCCCHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHH
HCGDLRDVDRKRVEWTGVSLEGTPWPAMMALSETRPLRECDSVWERYMGQRGPTRLWLYG
HCCCHHHHHHHHEEEECEEECCCCCHHHHHHHHCCCHHHHHHHHHHHHCCCCCCEEEEEC
PYRADDDKEPPILFSFDPDPEWSRESNERKLHEGGVCGTMSLISRNSQIARGIPAAPAGQ
CCCCCCCCCCCEEEECCCCCCCCCCCCCHHHHCCCCHHHHHHHHCCCHHHCCCCCCCCCC
PGHGNLMTTHFTGNGCWLSVGQSVDTLKATTGFWYFRDSNAPRTGNAEYQSGLALSMNID
CCCCCEEEEEEECCCEEEECCCCCHHHHHCCCEEEEECCCCCCCCCCHHHCCEEEEECCC
YEKFIDSRFAMNIYKLAATGSSTEETADPSATLPKEFTQTAMRTVLKANPFYTEAWYTLF
HHHHHHHHHHHHHHHEEECCCCCCCCCCCCCCCCHHHHHHHHHHHHHCCCCHHHHHHHHH
KQEPQDLMGATKMVDEVREALPDGMGIRKLWKTRKYVSSVGRGDKNGKDMLANHAREYVN
HCCHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHH
VLCSVILENALKQEYDYKTFQWAELMSWLKSESKRNSYPEPQAAYQIAYAKAQGTDRLKR
HHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHCCHHHHHH
TVDRGFKKALNFYRDDSNALKEPKDVDQEEMSFSLAALCQALPKEELIPWMKNMLDTCPD
HHHHHHHHHHHHHCCCCHHHCCCCCCCHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHCCC
GFKYKPKNKKETKIHPFYDALTKNYMSLADGSEKSRVKSEMKEASDRILELSQDKKGDGN
CCEECCCCCCCCCCCHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHCCCCCCCC
GSSGRRRRR
CCCCCCCCC
>Mature Secondary Structure 
TIPPPPALPPHFNIGGYKITALVESGPDYHLYQALSPEGHAVLIREFCPRGLVTRDLAS
CCCCCCCCCCCCCCCCEEEEEEEECCCCEEEEEECCCCCCEEEHHHHCCCCCCCHHCCC
GELAVSPENESQFAQAREAFETQYAANAEGKLRGFGTVLFLYPLSPAQPQPAAAHAQALR
CCEEECCCCHHHHHHHHHHHHHHHHCCCCCCEEECEEEEEEEECCCCCCCCHHHHHHHHC
PAKKPQQPQLRKPVVGAAIPGTPLPRVKHSGGFPVIPVIVTGMLALFGFLGYQILKDKEE
CCCCCCCCCHHCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCC
PVAKAVTVPVPAPPKPKPKPAPPKPEPVVVTPEPEPVVVAPEPEPEPEPEPPAPDLSPSP
HHHHEEEECCCCCCCCCCCCCCCCCCCEEECCCCCCEEECCCCCCCCCCCCCCCCCCCCC
EVIAMEKALREEAIASKGKFSEKLLNKYPHYAEAYVRDYVKKRGGSFSPDFEKWLKNTKN
CHHHHHHHHHHHHHHHCCCHHHHHHHHCCHHHHHHHHHHHHHCCCCCCCHHHHHHHCCCC
NREVFAMFFPPDPSVATNVAFMIDELGLETTEKYDQLVLAFAVGRREFGMGAFDLTHQGR
CCEEEEEEECCCCCHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHCCCCEECCCCCC
YVDALGKLNDLRSSGVMPPPADLYCAGKPPVNWYGNAPRTVDEECYKKVEAYLDRKKITP
HHHHHHHHHHHHHCCCCCCCCCEEECCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHCCCH
KQAWLRKYPTVSEIGDSAITEDNLAGFLHEYMYRHGQLRRKRDPFPTPVEFFSYLVDKYE
HHHHHHHCCCHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHH
HCGDLRDVDRKRVEWTGVSLEGTPWPAMMALSETRPLRECDSVWERYMGQRGPTRLWLYG
HCCCHHHHHHHHEEEECEEECCCCCHHHHHHHHCCCHHHHHHHHHHHHCCCCCCEEEEEC
PYRADDDKEPPILFSFDPDPEWSRESNERKLHEGGVCGTMSLISRNSQIARGIPAAPAGQ
CCCCCCCCCCCEEEECCCCCCCCCCCCCHHHHCCCCHHHHHHHHCCCHHHCCCCCCCCCC
PGHGNLMTTHFTGNGCWLSVGQSVDTLKATTGFWYFRDSNAPRTGNAEYQSGLALSMNID
CCCCCEEEEEEECCCEEEECCCCCHHHHHCCCEEEEECCCCCCCCCCHHHCCEEEEECCC
YEKFIDSRFAMNIYKLAATGSSTEETADPSATLPKEFTQTAMRTVLKANPFYTEAWYTLF
HHHHHHHHHHHHHHHEEECCCCCCCCCCCCCCCCHHHHHHHHHHHHHCCCCHHHHHHHHH
KQEPQDLMGATKMVDEVREALPDGMGIRKLWKTRKYVSSVGRGDKNGKDMLANHAREYVN
HCCHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHH
VLCSVILENALKQEYDYKTFQWAELMSWLKSESKRNSYPEPQAAYQIAYAKAQGTDRLKR
HHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHCCHHHHHH
TVDRGFKKALNFYRDDSNALKEPKDVDQEEMSFSLAALCQALPKEELIPWMKNMLDTCPD
HHHHHHHHHHHHHCCCCHHHCCCCCCCHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHCCC
GFKYKPKNKKETKIHPFYDALTKNYMSLADGSEKSRVKSEMKEASDRILELSQDKKGDGN
CCEECCCCCCCCCCCHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHCCCCCCCC
GSSGRRRRR
CCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA