Definition Methanosarcina mazei Go1 chromosome, complete genome.
Accession NC_003901
Length 4,096,345

Click here to switch to the map view.

The map label for this gene is yraQ [C]

Identifier: 21226838

GI number: 21226838

Start: 884177

End: 885211

Strand: Direct

Name: yraQ [C]

Synonym: MM_0736

Alternate gene names: 21226838

Gene position: 884177-885211 (Clockwise)

Preceding gene: 21226836

Following gene: 21226839

Centisome position: 21.58

GC content: 43.77

Gene sequence:

>1035_bases
ATGTATCTCATATCGGTCGGGTTCCAGTCGCTTCAGGAGTATCTAGCTCTGCATGTGCTGATGTGCCTCCTACCTGCCTT
TCTTCTAGCTGGAGCAATAGCCTCCCTCTTTTCCAAAGAATCCGTATTGAAGTTCTTTGGCGCGGATACCCCAAAATATA
TCTCATATACCGTAGCTGCGGTTTCAGGCTGCCTTCTTGCGGTCTGCAGCTGTACGGCTCTTCCTCTTTTTGCGGGGATA
TACAAAAGAGGAGCAGGAATAGGTCCTGCAACCACTTTTCTTTTCTCTGCCCCGGCAATCAATATCCTTGCAGTTGTTTA
TACCGCAAAAATCCTGGGATATGATATCGGAGCTGCAAGAGCCATTTTGGCTGTAATTATGTCAGTGTTTATAGGCCTTA
CAATGTCTCTGATTTACGAAAGGAAAGAAGCGGAAAAGAGTTCCATAAAAACCTTTGGAGAAGAAGAACACAAACACACT
GTTGAACTTTTTATTTTGCTAATTGCAGTTCTTGTAGCACCGGAATTCATGTCCTCGTGGGGCTGGAAATTCACAAATCA
AATAATTGCCTGGATACCCCTGATAGCTCTTACTGCATACCTGTCTATTAAGTGGTTCTCAAAAGAGGAGCTTGAAAGCT
GGATGGGAGAGACCTGGTTCCTGATAAAACAGATCACACCCCTGCTCCTTATAGGTGTATTTTTCGCAGGCATTATAGTT
GAAGTGCTCCCAAAAGAGATTGTAGCATCTCTGGTAGGAGGGAATTCCATTGCTTCTAACTTTGTCGCATCTATTGCAGC
AGCCCTTATGTACTTCTCCACTCTTACGGAAGTCCCTATCATCAAAGCTCTTACCCTGCTTGGAATGGGAACAGGACCTT
CTCTTGCCATGCTTCTTGCAGGTCCGGCACTTAGCCTTCCAAGTATGATTGTTATCAACCGGGTAATGGGAATAAAAAAA
GGAATGACTTATATTTTCTTCGTAATAGTGGTTGCAACTATTTCGGGGTATATATTCGGACTTACGATTGTGTAA

Upstream 100 bases:

>100_bases
ATTTGAAATAGGAAATTTTATATAGTTTATTTCAAATATATTTGAAATAATAACAAGAAATCTGAAAAAACCTGGTGGAA
AAATGACCATTGATTATCTT

Downstream 100 bases:

>100_bases
AAAATAATACTGAAACAAACAAGATCTAAATAACCCTAAGAAGAAATGAAGGCTAGAGATCAAATAAAAAAATGATAGAG
AATAAATAAAATTAATAAAA

Product: transporter

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 344; Mature: 344

Protein sequence:

>344_residues
MYLISVGFQSLQEYLALHVLMCLLPAFLLAGAIASLFSKESVLKFFGADTPKYISYTVAAVSGCLLAVCSCTALPLFAGI
YKRGAGIGPATTFLFSAPAINILAVVYTAKILGYDIGAARAILAVIMSVFIGLTMSLIYERKEAEKSSIKTFGEEEHKHT
VELFILLIAVLVAPEFMSSWGWKFTNQIIAWIPLIALTAYLSIKWFSKEELESWMGETWFLIKQITPLLLIGVFFAGIIV
EVLPKEIVASLVGGNSIASNFVASIAAALMYFSTLTEVPIIKALTLLGMGTGPSLAMLLAGPALSLPSMIVINRVMGIKK
GMTYIFFVIVVATISGYIFGLTIV

Sequences:

>Translated_344_residues
MYLISVGFQSLQEYLALHVLMCLLPAFLLAGAIASLFSKESVLKFFGADTPKYISYTVAAVSGCLLAVCSCTALPLFAGI
YKRGAGIGPATTFLFSAPAINILAVVYTAKILGYDIGAARAILAVIMSVFIGLTMSLIYERKEAEKSSIKTFGEEEHKHT
VELFILLIAVLVAPEFMSSWGWKFTNQIIAWIPLIALTAYLSIKWFSKEELESWMGETWFLIKQITPLLLIGVFFAGIIV
EVLPKEIVASLVGGNSIASNFVASIAAALMYFSTLTEVPIIKALTLLGMGTGPSLAMLLAGPALSLPSMIVINRVMGIKK
GMTYIFFVIVVATISGYIFGLTIV
>Mature_344_residues
MYLISVGFQSLQEYLALHVLMCLLPAFLLAGAIASLFSKESVLKFFGADTPKYISYTVAAVSGCLLAVCSCTALPLFAGI
YKRGAGIGPATTFLFSAPAINILAVVYTAKILGYDIGAARAILAVIMSVFIGLTMSLIYERKEAEKSSIKTFGEEEHKHT
VELFILLIAVLVAPEFMSSWGWKFTNQIIAWIPLIALTAYLSIKWFSKEELESWMGETWFLIKQITPLLLIGVFFAGIIV
EVLPKEIVASLVGGNSIASNFVASIAAALMYFSTLTEVPIIKALTLLGMGTGPSLAMLLAGPALSLPSMIVINRVMGIKK
GMTYIFFVIVVATISGYIFGLTIV

Specific function: Unknown

COG id: COG0701

COG function: function code R; Predicted permeases

Gene ontology:

Cell location: Cell membrane; Multi-pass membrane protein (Potential) [H]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the UPF0718 family [H]

Homologues:

Organism=Escherichia coli, GI1789541, Length=278, Percent_Identity=23.7410071942446, Blast_Score=63, Evalue=2e-11,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR005524 [H]

Pfam domain/function: PF03773 DUF318 [H]

EC number: NA

Molecular weight: Translated: 37129; Mature: 37129

Theoretical pI: Translated: 8.28; Mature: 8.28

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.2 %Cys     (Translated Protein)
3.5 %Met     (Translated Protein)
4.7 %Cys+Met (Translated Protein)
1.2 %Cys     (Mature Protein)
3.5 %Met     (Mature Protein)
4.7 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MYLISVGFQSLQEYLALHVLMCLLPAFLLAGAIASLFSKESVLKFFGADTPKYISYTVAA
CEEEHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHH
VSGCLLAVCSCTALPLFAGIYKRGAGIGPATTFLFSAPAINILAVVYTAKILGYDIGAAR
HHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHCCCHHHHHHHHHHHHHHHCCHHHHH
AILAVIMSVFIGLTMSLIYERKEAEKSSIKTFGEEEHKHTVELFILLIAVLVAPEFMSSW
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHC
GWKFTNQIIAWIPLIALTAYLSIKWFSKEELESWMGETWFLIKQITPLLLIGVFFAGIIV
CHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHCHHHHHHHHHHHHHHHHHHHHHHHH
EVLPKEIVASLVGGNSIASNFVASIAAALMYFSTLTEVPIIKALTLLGMGTGPSLAMLLA
HHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHH
GPALSLPSMIVINRVMGIKKGMTYIFFVIVVATISGYIFGLTIV
CCHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHEEC
>Mature Secondary Structure
MYLISVGFQSLQEYLALHVLMCLLPAFLLAGAIASLFSKESVLKFFGADTPKYISYTVAA
CEEEHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHH
VSGCLLAVCSCTALPLFAGIYKRGAGIGPATTFLFSAPAINILAVVYTAKILGYDIGAAR
HHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHCCCHHHHHHHHHHHHHHHCCHHHHH
AILAVIMSVFIGLTMSLIYERKEAEKSSIKTFGEEEHKHTVELFILLIAVLVAPEFMSSW
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHC
GWKFTNQIIAWIPLIALTAYLSIKWFSKEELESWMGETWFLIKQITPLLLIGVFFAGIIV
CHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHCHHHHHHHHHHHHHHHHHHHHHHHH
EVLPKEIVASLVGGNSIASNFVASIAAALMYFSTLTEVPIIKALTLLGMGTGPSLAMLLA
HHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHH
GPALSLPSMIVINRVMGIKKGMTYIFFVIVVATISGYIFGLTIV
CCHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHEEC

PDB accession: NA

Resolution: NA

Structure class: Alpha

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 7.0

TargetDB status: NA

Availability: NA

References: 8688087 [H]