| Definition | Methanosarcina mazei Go1 chromosome, complete genome. |
|---|---|
| Accession | NC_003901 |
| Length | 4,096,345 |
Click here to switch to the map view.
The map label for this gene is yncE [C]
Identifier: 21226145
GI number: 21226145
Start: 55009
End: 57651
Strand: Reverse
Name: yncE [C]
Synonym: MM_0043
Alternate gene names: 21226145
Gene position: 57651-55009 (Counterclockwise)
Preceding gene: 21226149
Following gene: 21226141
Centisome position: 1.41
GC content: 40.37
Gene sequence:
>2643_bases ATGAGGAAAATACTAATTTTTTTAATAGTTCTAATTTTTATTTTTATAATATCTATTTCAGCTACTTCATCAGCAAAGGA AATTACAGTGGATGATGGTTCTGGAGCTGATTTCAGATCAATTCAGGAAGCTGTGAATAATTCTGTACCAGGGGACACAA TAACCGTGATGCCTGGAATTTATACTGAAAACGTTCTTGTCAATATAACCGGGCTAACTATCAAGTCAGAATCAAACAAT GGTGATGCGCAGGTAAAACCGCTAAATGAAAGTGTAAGTACCTTTCTGATAACAGCTAATAGCACAACGATCAGTGGTTT AAATATAACAGGAGCCAGTAAGATGAATCATAAAAATGCAATCTTTGCTTATAGCAAGAGGAATAATGTAACAGGTAATA CTATTGAAAACGGTTCTATTTTTCTGGGATCCTACATGCCAAGCAATTTAAAAATCATCTTTCATGGCGATATGAATAAT GTGACAGGTAATATCATTGAAAACGGTTCTATTTTTCTGGGATCCGAGATTTCAGGCAATTTAATAGCCGAAAATAAAAT TTCTAACGGCGAAGAGGGTGTATATATTTCCTGCTGTGGAGGAAATAATACAGTATCAGGTAATACGATCTCAAATTGTT CCACTGGCATCTCCGAAGGGGATCAGGGAGCAGATATTCGTAATAACAGGATTACTGACTGCGATTGTGGGATTTGGCTT TCGATGTCAAGTTCAGGAATTGAAAATAATACAATATTAAACTGTGATGTAGGGATTATTTTAGGTGACGCTTGTACTGT TGACATAATCAACAATACAATAACATCCTGTACAGAATGTGGGATTTTTAATAGGGGAAATTATGACCGTAGAAGAATCT ACAATAATTATTTTAACAATAGTCTAAACGTAAAGTTTGGACCTGGCGAAGGGGGAAATATCTGGAACAGTTCACTTGCT TCAGGCAGTAACATTGCCGATGGCCCTTACATTGGAGGAAACTTCTGGGCAAAGCCAGATGGGACCGGATTCTCCCAGAT CTGCGTGGATCTGGATAGGAATGGGATCGGAGACCTGCCTTATAATATCTATGAGAATGAATTTGACTATTTGCCTCTTG TATCTATGTCCAGTCTGCAAAATTCAGTTACTCCAACTGCTAACTTTACAGCCAGCGTCACTAATGGTCCTGCACCCCTT GTTGTCAAGTTTTCAGACCTTTCGAAAAACGCAGTTGCGTGGAACTGGGACTTTGATAATGATGGTATATCAGATTCCAC AGAACAAAATCCTGTACATGTGTACAGAGCTCAAGGAAATTATACAGTTAATTTGACAGCTAGCAATGGATTCAATACTA ATTCCAAACTTGCAAACATAAGCGTTGAAAAAAGGGTTTCATCCACGTGGCCGTTTATATACATTATAGGTGGAACTGTC TCTGTAATTGACACAGCCACAGGATTAGTTATAACCAAAGTAAAAGTAGGACGTTCAATGCCTGAAGGAGTTGCAGTCAC GCCAGATGGAAAAAAGGCATATGTACCTGACCGTTGGGGTGTTAATGTATCCGTAGTTGATACTGCAACAAATACTGTTA TAGACACTGTGAAAGTAGGATCTGATCCCTATGGAGTTGCAATCAGTCCTGATGGAAAAAAGGTATATGTGGCTAACAGT GGCAGCAATAATATTTCTATAATTAACACCGACGCAAACACTGTTACAGCTACTGTGCCTGTTGGAATTAGCCCTACTGG AGTTGCTGTCGTACCGGATGGATCAAAGGTGTATGTGGCGAATTCAGGCAGTTATCCAAGCTACGAGGGTACTGTTTCTG TAATTGATACAGCTACTAGCATGGTCACAGCTACGGTACATGTAGGAAATCATCCTTCTAGAGTTGCAGTAACCCCGGAT GGAAAAAAGGTATATGTGGCAAACTGGGGTCATTATGTCTCTGTAGTTGATACAGCTACAAATACTGTTACAGCTACGGT GGATGTAGATAATTCTCCTGATGAAATTGTTGTCAATCCTACAGGAACAAAGGTATATGTGGCAGGAATGAAGAAGGGAT ATGCTGCTGGCACAGACGATGGTTTCGTCTCTGCAATTGGTACCTCAAACAATACTATTATAGCTACAATGGATATTGTA GGAGGCAGTCCTATAGGACTTGCAGTAACCCCAGATGGAAAAACGGTGTATGTGGCAAACAGCAACATTTCTGGTAACAG TACTCTCTCTGTAATTGACACCTCAAACGATACTGTCTCAGCAACAGTGAATATCGAGACTCCTGGTAGAATTGCAATCA TCCCGGATCCGGAATCAGTATTTCCGGTAGCTAATTTCAGCAGCAATGTCAGTGAAGGTTTTGCACCTCTCTCAGTTCAG TTTACCGACAGCTCCGAAAACACAACGGGGTGGAACTGGAACTTTGGTGATGGAGCTGCTTCAAAAGAACAGAATCCAGC TCACACTTATTTATCACCAGGAAACTATACAGCTTGTCTGATAGTAAACAACCCGGATGGTACAGATTCGAAGTTTACTA CAATAACTGTGCTGGAAAGTAGTTCTGGCGATGATAGTCAGTCCAGTGGAGGAAGCAGCAAGGGCGGCAGCAGCGGTGGT TGA
Upstream 100 bases:
>100_bases ATCAAAAATAACTATGGAAATTAAAATATATTATATTTAATTAATAAGATTTATATTAATATTAATAAGGGATTATCTTA TAATAGAATGGGGGAAATAA
Downstream 100 bases:
>100_bases GGCGGATCCCCTGTACCTGCAAAAAACGTTGAGGTCAAGGAACTTTTTCAGGTCTTCATTACAAACGGAAACCCTGTAAA GTTTAATTTCCCAAAGAACG
Product: hypothetical protein
Products: NA
Alternate protein names: YVTN Beta-Propeller Repeat-Containing Protein; 40-Residue YVTN Family Beta-Propeller Repeat Protein; Surface Antigen Gene; Surface Layer Protein; Surface Layer Protein B; YVTN Family Beta-Propeller Repeat Protein; Cell Surface Glycoprotein; Triple Helix Repeat-Containing Collagen; PKD Domain-Containing Protein; NHL Repeat Containing Protein; Alpha-1 2-Mannosidase; Glycine-Rich Cell Wall Protein; Vegetative Incompatibility; Beta-Propeller Fold Protein; Signal Peptide; SGL Domain-Containing Protein; LOW QUALITY PROTEIN Surface Antigen Protein; Surface Antigen; IPT/TIG Domain Protein; 40-Residue Yvtn Family Beta-Propeller Repeat Protein; Serine/Threonine Protein Kinase; Secreted Protein; Alkaline Serine Protease; YVTN Family Beta-Propeller Repeat Family Protein
Number of amino acids: Translated: 880; Mature: 880
Protein sequence:
>880_residues MRKILIFLIVLIFIFIISISATSSAKEITVDDGSGADFRSIQEAVNNSVPGDTITVMPGIYTENVLVNITGLTIKSESNN GDAQVKPLNESVSTFLITANSTTISGLNITGASKMNHKNAIFAYSKRNNVTGNTIENGSIFLGSYMPSNLKIIFHGDMNN VTGNIIENGSIFLGSEISGNLIAENKISNGEEGVYISCCGGNNTVSGNTISNCSTGISEGDQGADIRNNRITDCDCGIWL SMSSSGIENNTILNCDVGIILGDACTVDIINNTITSCTECGIFNRGNYDRRRIYNNYFNNSLNVKFGPGEGGNIWNSSLA SGSNIADGPYIGGNFWAKPDGTGFSQICVDLDRNGIGDLPYNIYENEFDYLPLVSMSSLQNSVTPTANFTASVTNGPAPL VVKFSDLSKNAVAWNWDFDNDGISDSTEQNPVHVYRAQGNYTVNLTASNGFNTNSKLANISVEKRVSSTWPFIYIIGGTV SVIDTATGLVITKVKVGRSMPEGVAVTPDGKKAYVPDRWGVNVSVVDTATNTVIDTVKVGSDPYGVAISPDGKKVYVANS GSNNISIINTDANTVTATVPVGISPTGVAVVPDGSKVYVANSGSYPSYEGTVSVIDTATSMVTATVHVGNHPSRVAVTPD GKKVYVANWGHYVSVVDTATNTVTATVDVDNSPDEIVVNPTGTKVYVAGMKKGYAAGTDDGFVSAIGTSNNTIIATMDIV GGSPIGLAVTPDGKTVYVANSNISGNSTLSVIDTSNDTVSATVNIETPGRIAIIPDPESVFPVANFSSNVSEGFAPLSVQ FTDSSENTTGWNWNFGDGAASKEQNPAHTYLSPGNYTACLIVNNPDGTDSKFTTITVLESSSGDDSQSSGGSSKGGSSGG
Sequences:
>Translated_880_residues MRKILIFLIVLIFIFIISISATSSAKEITVDDGSGADFRSIQEAVNNSVPGDTITVMPGIYTENVLVNITGLTIKSESNN GDAQVKPLNESVSTFLITANSTTISGLNITGASKMNHKNAIFAYSKRNNVTGNTIENGSIFLGSYMPSNLKIIFHGDMNN VTGNIIENGSIFLGSEISGNLIAENKISNGEEGVYISCCGGNNTVSGNTISNCSTGISEGDQGADIRNNRITDCDCGIWL SMSSSGIENNTILNCDVGIILGDACTVDIINNTITSCTECGIFNRGNYDRRRIYNNYFNNSLNVKFGPGEGGNIWNSSLA SGSNIADGPYIGGNFWAKPDGTGFSQICVDLDRNGIGDLPYNIYENEFDYLPLVSMSSLQNSVTPTANFTASVTNGPAPL VVKFSDLSKNAVAWNWDFDNDGISDSTEQNPVHVYRAQGNYTVNLTASNGFNTNSKLANISVEKRVSSTWPFIYIIGGTV SVIDTATGLVITKVKVGRSMPEGVAVTPDGKKAYVPDRWGVNVSVVDTATNTVIDTVKVGSDPYGVAISPDGKKVYVANS GSNNISIINTDANTVTATVPVGISPTGVAVVPDGSKVYVANSGSYPSYEGTVSVIDTATSMVTATVHVGNHPSRVAVTPD GKKVYVANWGHYVSVVDTATNTVTATVDVDNSPDEIVVNPTGTKVYVAGMKKGYAAGTDDGFVSAIGTSNNTIIATMDIV GGSPIGLAVTPDGKTVYVANSNISGNSTLSVIDTSNDTVSATVNIETPGRIAIIPDPESVFPVANFSSNVSEGFAPLSVQ FTDSSENTTGWNWNFGDGAASKEQNPAHTYLSPGNYTACLIVNNPDGTDSKFTTITVLESSSGDDSQSSGGSSKGGSSGG >Mature_880_residues MRKILIFLIVLIFIFIISISATSSAKEITVDDGSGADFRSIQEAVNNSVPGDTITVMPGIYTENVLVNITGLTIKSESNN GDAQVKPLNESVSTFLITANSTTISGLNITGASKMNHKNAIFAYSKRNNVTGNTIENGSIFLGSYMPSNLKIIFHGDMNN VTGNIIENGSIFLGSEISGNLIAENKISNGEEGVYISCCGGNNTVSGNTISNCSTGISEGDQGADIRNNRITDCDCGIWL SMSSSGIENNTILNCDVGIILGDACTVDIINNTITSCTECGIFNRGNYDRRRIYNNYFNNSLNVKFGPGEGGNIWNSSLA SGSNIADGPYIGGNFWAKPDGTGFSQICVDLDRNGIGDLPYNIYENEFDYLPLVSMSSLQNSVTPTANFTASVTNGPAPL VVKFSDLSKNAVAWNWDFDNDGISDSTEQNPVHVYRAQGNYTVNLTASNGFNTNSKLANISVEKRVSSTWPFIYIIGGTV SVIDTATGLVITKVKVGRSMPEGVAVTPDGKKAYVPDRWGVNVSVVDTATNTVIDTVKVGSDPYGVAISPDGKKVYVANS GSNNISIINTDANTVTATVPVGISPTGVAVVPDGSKVYVANSGSYPSYEGTVSVIDTATSMVTATVHVGNHPSRVAVTPD GKKVYVANWGHYVSVVDTATNTVTATVDVDNSPDEIVVNPTGTKVYVAGMKKGYAAGTDDGFVSAIGTSNNTIIATMDIV GGSPIGLAVTPDGKTVYVANSNISGNSTLSVIDTSNDTVSATVNIETPGRIAIIPDPESVFPVANFSSNVSEGFAPLSVQ FTDSSENTTGWNWNFGDGAASKEQNPAHTYLSPGNYTACLIVNNPDGTDSKFTTITVLESSSGDDSQSSGGSSKGGSSGG
Specific function: Unknown
COG id: COG3291
COG function: function code R; FOG: PKD repeat
Gene ontology:
Cell location: Cytoplasmic
Metaboloic importance: Non Essential [C]
Operon status: Not Known
Operon components: None
Similarity: NA
Homologues:
None
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
NA
Pfam domain/function: NA
EC number: NA
Molecular weight: Translated: 92113; Mature: 92113
Theoretical pI: Translated: 4.30; Mature: 4.30
Prosite motif: PS50093 PKD ; PS00962 RIBOSOMAL_S2_1
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.2 %Cys (Translated Protein) 1.2 %Met (Translated Protein) 2.5 %Cys+Met (Translated Protein) 1.2 %Cys (Mature Protein) 1.2 %Met (Mature Protein) 2.5 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MRKILIFLIVLIFIFIISISATSSAKEITVDDGSGADFRSIQEAVNNSVPGDTITVMPGI CHHHHHHHHHHHHHHHHEECCCCCCCEEEEECCCCCCHHHHHHHHHCCCCCCEEEEECCC YTENVLVNITGLTIKSESNNGDAQVKPLNESVSTFLITANSTTISGLNITGASKMNHKNA EECCEEEEEEEEEEEECCCCCCEEEEECCCCCEEEEEEECCCEEEEEEEECCCCCCCCCE IFAYSKRNNVTGNTIENGSIFLGSYMPSNLKIIFHGDMNNVTGNIIENGSIFLGSEISGN EEEEECCCCCCCCEECCCCEEEEEECCCCEEEEEECCCCCCCCEEEECCCEEEECCCCCC LIAENKISNGEEGVYISCCGGNNTVSGNTISNCSTGISEGDQGADIRNNRITDCDCGIWL EEEECCCCCCCCCEEEEEECCCCEECCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCEEE SMSSSGIENNTILNCDVGIILGDACTVDIINNTITSCTECGIFNRGNYDRRRIYNNYFNN EECCCCCCCCEEEEEEEEEEECCEEEEEEHHCCHHHHHHCCCCCCCCCHHHHHHHHHCCC SLNVKFGPGEGGNIWNSSLASGSNIADGPYIGGNFWAKPDGTGFSQICVDLDRNGIGDLP EEEEEECCCCCCCCCCCCCCCCCCCCCCCEECCEEEECCCCCCHHHEEEEECCCCCCCCC YNIYENEFDYLPLVSMSSLQNSVTPTANFTASVTNGPAPLVVKFSDLSKNAVAWNWDFDN CEEECCCCCEECEEEHHHHHCCCCCCCCEEEEECCCCCEEEEEEECCCCCEEEEEECCCC DGISDSTEQNPVHVYRAQGNYTVNLTASNGFNTNSKLANISVEKRVSSTWPFIYIIGGTV CCCCCCCCCCCEEEEEECCCEEEEEEECCCCCCCCEEEEEEEEHHHCCCCCEEEEECCEE SVIDTATGLVITKVKVGRSMPEGVAVTPDGKKAYVPDRWGVNVSVVDTATNTVIDTVKVG EEEECCCCEEEEEEECCCCCCCCEEECCCCCEEECCCCCCCEEEEEECCCCEEEEEEEEC SDPYGVAISPDGKKVYVANSGSNNISIINTDANTVTATVPVGISPTGVAVVPDGSKVYVA CCCCEEEECCCCCEEEEEECCCCEEEEEECCCCEEEEEEECCCCCCCEEEECCCCEEEEE NSGSYPSYEGTVSVIDTATSMVTATVHVGNHPSRVAVTPDGKKVYVANWGHYVSVVDTAT ECCCCCCCCCEEEEEECCCEEEEEEEEECCCCCEEEECCCCCEEEEEECCCEEEEEECCC NTVTATVDVDNSPDEIVVNPTGTKVYVAGMKKGYAAGTDDGFVSAIGTSNNTIIATMDIV CEEEEEEECCCCCCEEEECCCCCEEEEEECCCCCCCCCCCCEEEEECCCCCEEEEEEEEC GGSPIGLAVTPDGKTVYVANSNISGNSTLSVIDTSNDTVSATVNIETPGRIAIIPDPESV CCCCEEEEECCCCCEEEEECCCCCCCCEEEEEECCCCEEEEEEEECCCCEEEEECCCCCE FPVANFSSNVSEGFAPLSVQFTDSSENTTGWNWNFGDGAASKEQNPAHTYLSPGNYTACL EEECCCCCCHHCCCCEEEEEEECCCCCCCCCCEECCCCCCCCCCCCCEEEECCCCEEEEE IVNNPDGTDSKFTTITVLESSSGDDSQSSGGSSKGGSSGG EEECCCCCCCEEEEEEEEECCCCCCCCCCCCCCCCCCCCC >Mature Secondary Structure MRKILIFLIVLIFIFIISISATSSAKEITVDDGSGADFRSIQEAVNNSVPGDTITVMPGI CHHHHHHHHHHHHHHHHEECCCCCCCEEEEECCCCCCHHHHHHHHHCCCCCCEEEEECCC YTENVLVNITGLTIKSESNNGDAQVKPLNESVSTFLITANSTTISGLNITGASKMNHKNA EECCEEEEEEEEEEEECCCCCCEEEEECCCCCEEEEEEECCCEEEEEEEECCCCCCCCCE IFAYSKRNNVTGNTIENGSIFLGSYMPSNLKIIFHGDMNNVTGNIIENGSIFLGSEISGN EEEEECCCCCCCCEECCCCEEEEEECCCCEEEEEECCCCCCCCEEEECCCEEEECCCCCC LIAENKISNGEEGVYISCCGGNNTVSGNTISNCSTGISEGDQGADIRNNRITDCDCGIWL EEEECCCCCCCCCEEEEEECCCCEECCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCEEE SMSSSGIENNTILNCDVGIILGDACTVDIINNTITSCTECGIFNRGNYDRRRIYNNYFNN EECCCCCCCCEEEEEEEEEEECCEEEEEEHHCCHHHHHHCCCCCCCCCHHHHHHHHHCCC SLNVKFGPGEGGNIWNSSLASGSNIADGPYIGGNFWAKPDGTGFSQICVDLDRNGIGDLP EEEEEECCCCCCCCCCCCCCCCCCCCCCCEECCEEEECCCCCCHHHEEEEECCCCCCCCC YNIYENEFDYLPLVSMSSLQNSVTPTANFTASVTNGPAPLVVKFSDLSKNAVAWNWDFDN CEEECCCCCEECEEEHHHHHCCCCCCCCEEEEECCCCCEEEEEEECCCCCEEEEEECCCC DGISDSTEQNPVHVYRAQGNYTVNLTASNGFNTNSKLANISVEKRVSSTWPFIYIIGGTV CCCCCCCCCCCEEEEEECCCEEEEEEECCCCCCCCEEEEEEEEHHHCCCCCEEEEECCEE SVIDTATGLVITKVKVGRSMPEGVAVTPDGKKAYVPDRWGVNVSVVDTATNTVIDTVKVG EEEECCCCEEEEEEECCCCCCCCEEECCCCCEEECCCCCCCEEEEEECCCCEEEEEEEEC SDPYGVAISPDGKKVYVANSGSNNISIINTDANTVTATVPVGISPTGVAVVPDGSKVYVA CCCCEEEECCCCCEEEEEECCCCEEEEEECCCCEEEEEEECCCCCCCEEEECCCCEEEEE NSGSYPSYEGTVSVIDTATSMVTATVHVGNHPSRVAVTPDGKKVYVANWGHYVSVVDTAT ECCCCCCCCCEEEEEECCCEEEEEEEEECCCCCEEEECCCCCEEEEEECCCEEEEEECCC NTVTATVDVDNSPDEIVVNPTGTKVYVAGMKKGYAAGTDDGFVSAIGTSNNTIIATMDIV CEEEEEEECCCCCCEEEECCCCCEEEEEECCCCCCCCCCCCEEEEECCCCCEEEEEEEEC GGSPIGLAVTPDGKTVYVANSNISGNSTLSVIDTSNDTVSATVNIETPGRIAIIPDPESV CCCCEEEEECCCCCEEEEECCCCCCCCEEEEEECCCCEEEEEEEECCCCEEEEECCCCCE FPVANFSSNVSEGFAPLSVQFTDSSENTTGWNWNFGDGAASKEQNPAHTYLSPGNYTACL EEECCCCCCHHCCCCEEEEEEECCCCCCCCCCEECCCCCCCCCCCCCEEEECCCCEEEEE IVNNPDGTDSKFTTITVLESSSGDDSQSSGGSSKGGSSGG EEECCCCCCCEEEEEEEEECCCCCCCCCCCCCCCCCCCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: NA