Definition Akkermansia muciniphila ATCC BAA-835, complete genome.
Accession NC_010655
Length 2,664,102

Click here to switch to the map view.

The map label for this gene is yuaG [H]

Identifier: 187735084

GI number: 187735084

Start: 679432

End: 680934

Strand: Direct

Name: yuaG [H]

Synonym: Amuc_0578

Alternate gene names: 187735084

Gene position: 679432-680934 (Clockwise)

Preceding gene: 187735083

Following gene: 187735085

Centisome position: 25.5

GC content: 59.35

Gene sequence:

>1503_bases
ATGGACAAAATCATCCCCATCGCCATTCTGGTTCTCTTCATCATTCTGACCGCTTCCTGGCTGTTCAGCCGCTACCGCAT
GTGCCCTCCGGACAAAATCCTCATCGTCTTCGGGAAAGTAGGCACAGGCCAGCCGGCCAAATGTTACCACGGCGGCTCCA
CCTTCGTGCTTCCGGTTCTCCAGTCCTATAGCTACCTGGATCTGAACCCTATCAATATTGACGTGCCCCTCCAGGGCGCC
CTTTCCTCCCAGAACATACGCGTGGATGTGCCCTCCTCCTTCATCGTGGGCATCTCCACCCTCCCTGAAATCATGCAGAA
CGCCGCTGCGCGCCTGCTGGGCCGCTCCCGGGAGGAAATCCGCAACCTGGCCGCGGAAATCATCATGGGGCAGATGCGCG
TGGTGATTGCCTCCATGACCATTGAGGAAATCAATTCCGACCGCGAAAAACTCATCAAGGGCATCACGGAAGGCGTGGAC
GTGGAACTGCACAAAGTGGGCCTCCATCTCATCAACGCCAATATCACGGACATCCAGGACGCTTCCGGCTACATCAACGC
CCTGGGCAAGGAAGCCGCTGCGCGCGCCATCAATGACGCCACCATCAAGGTGGCGGAAGAAACGCGCCGCGGGGAAATCG
GCAAAGCGGAAGCGGAAAAGGACCAGACCATCCAGGTGGCGAACGCCCGCGCCATCGCCATTGAGGGCCAGAACGAAGCC
CAGATTAAAATTGCGGAATCCGCCGCCAAGCTGCAAGTGAAGCAGGCGGAGGCCAAAAAGCTGGCGGAAGTGGCCCAGAA
GGTGCAGGAGGCTAAAACCCTGGAAGAAGCCTACCAGGCGGAAAAAGAAGCGGAATTGAAGCGCGCGGAACGCGAACGCG
CCACGCAGGAAGCCAACATCCTGGTAACGGCCCGCATTGAAAAGAGCCAGCGCGAAGTGCAGGCCCAGGCCACGGCGGAA
GTACTCAAACTGGAACAGGAAGGCAAGGCGCAGGCTCTGCTCATCCAGCGCAGGGCGGAAGCGGAAGCCATCCGCCAACT
GGCGGAAGGCGAAGCCCAGGCTACCCTCCTGAAGAAAAAGGCGGAAGGGGAAGGCATGGAAATGGTGGGACGCGGTGAAG
CGGCCGCGATTGAAGCCGTGCTGGAAGGCAAGGCCCGCGGTTTTCAGCAGATCGTCCAGGCGGCAGGTTCTTCCGAGGCC
GCTTCCAACCTGCTGGTGACGGAACAGCTTACCAAGATTGTGGAGCTCCAGTCCGGCGCCATTAAGGGGTTGAAATTCGA
CAAGGTAGTCGTCATGGGCAATGGAGGGAACTCCTCTGTGGGAGGATTCGTCCAGAATCTGGTAAAGGATACGCTGCCCC
TTCATGAACTCGGCAAAAGCGTAGGGCTGGAATTGCCCGCTTTTCTGGGCAAACCCATGGAAGGGAAAACCGCAGCTTCC
TCCCCTGCTCCCGCAGCCGATGCCCCGGCGGCAGATACCGCAACCGCCGTCAACCCGAGTTAG

Upstream 100 bases:

>100_bases
CTCCGGAACCCCGGTGGAAGTGGTAGCCGTCACTGCGGGAATCGTCACCGTCAAACCTCTTCATTAACAAACACCCCAAT
CATCATACCCCAAGCCGACT

Downstream 100 bases:

>100_bases
CCCCTTCATCCCCGCCTTCCTGACGGCAACCGCCTCCCCCCCCCCCCCCGGATAGACAGGGCAGATCTGGACAGCATTGT
CCATATTGACGCAGGGCGCA

Product: band 7 protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 500; Mature: 500

Protein sequence:

>500_residues
MDKIIPIAILVLFIILTASWLFSRYRMCPPDKILIVFGKVGTGQPAKCYHGGSTFVLPVLQSYSYLDLNPINIDVPLQGA
LSSQNIRVDVPSSFIVGISTLPEIMQNAAARLLGRSREEIRNLAAEIIMGQMRVVIASMTIEEINSDREKLIKGITEGVD
VELHKVGLHLINANITDIQDASGYINALGKEAAARAINDATIKVAEETRRGEIGKAEAEKDQTIQVANARAIAIEGQNEA
QIKIAESAAKLQVKQAEAKKLAEVAQKVQEAKTLEEAYQAEKEAELKRAERERATQEANILVTARIEKSQREVQAQATAE
VLKLEQEGKAQALLIQRRAEAEAIRQLAEGEAQATLLKKKAEGEGMEMVGRGEAAAIEAVLEGKARGFQQIVQAAGSSEA
ASNLLVTEQLTKIVELQSGAIKGLKFDKVVVMGNGGNSSVGGFVQNLVKDTLPLHELGKSVGLELPAFLGKPMEGKTAAS
SPAPAADAPAADTATAVNPS

Sequences:

>Translated_500_residues
MDKIIPIAILVLFIILTASWLFSRYRMCPPDKILIVFGKVGTGQPAKCYHGGSTFVLPVLQSYSYLDLNPINIDVPLQGA
LSSQNIRVDVPSSFIVGISTLPEIMQNAAARLLGRSREEIRNLAAEIIMGQMRVVIASMTIEEINSDREKLIKGITEGVD
VELHKVGLHLINANITDIQDASGYINALGKEAAARAINDATIKVAEETRRGEIGKAEAEKDQTIQVANARAIAIEGQNEA
QIKIAESAAKLQVKQAEAKKLAEVAQKVQEAKTLEEAYQAEKEAELKRAERERATQEANILVTARIEKSQREVQAQATAE
VLKLEQEGKAQALLIQRRAEAEAIRQLAEGEAQATLLKKKAEGEGMEMVGRGEAAAIEAVLEGKARGFQQIVQAAGSSEA
ASNLLVTEQLTKIVELQSGAIKGLKFDKVVVMGNGGNSSVGGFVQNLVKDTLPLHELGKSVGLELPAFLGKPMEGKTAAS
SPAPAADAPAADTATAVNPS
>Mature_500_residues
MDKIIPIAILVLFIILTASWLFSRYRMCPPDKILIVFGKVGTGQPAKCYHGGSTFVLPVLQSYSYLDLNPINIDVPLQGA
LSSQNIRVDVPSSFIVGISTLPEIMQNAAARLLGRSREEIRNLAAEIIMGQMRVVIASMTIEEINSDREKLIKGITEGVD
VELHKVGLHLINANITDIQDASGYINALGKEAAARAINDATIKVAEETRRGEIGKAEAEKDQTIQVANARAIAIEGQNEA
QIKIAESAAKLQVKQAEAKKLAEVAQKVQEAKTLEEAYQAEKEAELKRAERERATQEANILVTARIEKSQREVQAQATAE
VLKLEQEGKAQALLIQRRAEAEAIRQLAEGEAQATLLKKKAEGEGMEMVGRGEAAAIEAVLEGKARGFQQIVQAAGSSEA
ASNLLVTEQLTKIVELQSGAIKGLKFDKVVVMGNGGNSSVGGFVQNLVKDTLPLHELGKSVGLELPAFLGKPMEGKTAAS
SPAPAADAPAADTATAVNPS

Specific function: Unknown

COG id: COG2268

COG function: function code S; Uncharacterized protein conserved in bacteria

Gene ontology:

Cell location: Membrane; Single-pass membrane protein (Potential) [H]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: To E.coli yqiK and Synechocystis PCC 6803 sll1021 [H]

Homologues:

Organism=Homo sapiens, GI5031699, Length=467, Percent_Identity=26.9807280513919, Blast_Score=117, Evalue=4e-26,
Organism=Homo sapiens, GI94538362, Length=435, Percent_Identity=27.3563218390805, Blast_Score=110, Evalue=3e-24,
Organism=Escherichia coli, GI1789430, Length=326, Percent_Identity=26.9938650306748, Blast_Score=64, Evalue=2e-11,
Organism=Drosophila melanogaster, GI17137546, Length=341, Percent_Identity=29.3255131964809, Blast_Score=110, Evalue=2e-24,
Organism=Drosophila melanogaster, GI24653894, Length=345, Percent_Identity=28.9855072463768, Blast_Score=106, Evalue=3e-23,
Organism=Drosophila melanogaster, GI24642033, Length=450, Percent_Identity=26, Blast_Score=100, Evalue=4e-21,
Organism=Drosophila melanogaster, GI24642031, Length=450, Percent_Identity=26, Blast_Score=100, Evalue=4e-21,
Organism=Drosophila melanogaster, GI24642029, Length=463, Percent_Identity=25.4859611231102, Blast_Score=91, Evalue=2e-18,
Organism=Drosophila melanogaster, GI24642027, Length=463, Percent_Identity=25.4859611231102, Blast_Score=91, Evalue=2e-18,
Organism=Drosophila melanogaster, GI24642061, Length=377, Percent_Identity=27.3209549071618, Blast_Score=85, Evalue=2e-16,
Organism=Drosophila melanogaster, GI281360882, Length=353, Percent_Identity=26.628895184136, Blast_Score=66, Evalue=5e-11,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR001107 [H]

Pfam domain/function: PF01145 Band_7 [H]

EC number: NA

Molecular weight: Translated: 53488; Mature: 53488

Theoretical pI: Translated: 5.34; Mature: 5.34

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.4 %Cys     (Translated Protein)
2.0 %Met     (Translated Protein)
2.4 %Cys+Met (Translated Protein)
0.4 %Cys     (Mature Protein)
2.0 %Met     (Mature Protein)
2.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MDKIIPIAILVLFIILTASWLFSRYRMCPPDKILIVFGKVGTGQPAKCYHGGSTFVLPVL
CCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCEEEEEEECCCCCCCCCEEECCCEEHHHHH
QSYSYLDLNPINIDVPLQGALSSQNIRVDVPSSFIVGISTLPEIMQNAAARLLGRSREEI
HCCCCCCCCCEEEECCCCCCCCCCCEEEECCCHHHHHHHHHHHHHHHHHHHHHCCCHHHH
RNLAAEIIMGQMRVVIASMTIEEINSDREKLIKGITEGVDVELHKVGLHLINANITDIQD
HHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHCCCCEEEEEECEEEEECCCCCCCC
ASGYINALGKEAAARAINDATIKVAEETRRGEIGKAEAEKDQTIQVANARAIAIEGQNEA
CHHHHHHHHHHHHHHHHCCHHEEEEHHHCCCCCCCCCCCCCCEEEEECCEEEEEECCCCC
QIKIAESAAKLQVKQAEAKKLAEVAQKVQEAKTLEEAYQAEKEAELKRAERERATQEANI
EEEEECHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCE
LVTARIEKSQREVQAQATAEVLKLEQEGKAQALLIQRRAEAEAIRQLAEGEAQATLLKKK
EEEEEEHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHH
AEGEGMEMVGRGEAAAIEAVLEGKARGFQQIVQAAGSSEAASNLLVTEQLTKIVELQSGA
CCCCCCEEECCCHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHCCC
IKGLKFDKVVVMGNGGNSSVGGFVQNLVKDTLPLHELGKSVGLELPAFLGKPMEGKTAAS
CCCCEEEEEEEEECCCCCCHHHHHHHHHHHCCCHHHHHHHHCCCCHHHHCCCCCCCCCCC
SPAPAADAPAADTATAVNPS
CCCCCCCCCCCCCCCCCCCC
>Mature Secondary Structure
MDKIIPIAILVLFIILTASWLFSRYRMCPPDKILIVFGKVGTGQPAKCYHGGSTFVLPVL
CCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCEEEEEEECCCCCCCCCEEECCCEEHHHHH
QSYSYLDLNPINIDVPLQGALSSQNIRVDVPSSFIVGISTLPEIMQNAAARLLGRSREEI
HCCCCCCCCCEEEECCCCCCCCCCCEEEECCCHHHHHHHHHHHHHHHHHHHHHCCCHHHH
RNLAAEIIMGQMRVVIASMTIEEINSDREKLIKGITEGVDVELHKVGLHLINANITDIQD
HHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHCCCCEEEEEECEEEEECCCCCCCC
ASGYINALGKEAAARAINDATIKVAEETRRGEIGKAEAEKDQTIQVANARAIAIEGQNEA
CHHHHHHHHHHHHHHHHCCHHEEEEHHHCCCCCCCCCCCCCCEEEEECCEEEEEECCCCC
QIKIAESAAKLQVKQAEAKKLAEVAQKVQEAKTLEEAYQAEKEAELKRAERERATQEANI
EEEEECHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCE
LVTARIEKSQREVQAQATAEVLKLEQEGKAQALLIQRRAEAEAIRQLAEGEAQATLLKKK
EEEEEEHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHH
AEGEGMEMVGRGEAAAIEAVLEGKARGFQQIVQAAGSSEAASNLLVTEQLTKIVELQSGA
CCCCCCEEECCCHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHCCC
IKGLKFDKVVVMGNGGNSSVGGFVQNLVKDTLPLHELGKSVGLELPAFLGKPMEGKTAAS
CCCCEEEEEEEEECCCCCCHHHHHHHHHHHCCCHHHHHHHHCCCCHHHHCCCCCCCCCCC
SPAPAADAPAADTATAVNPS
CCCCCCCCCCCCCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 9384377 [H]