| Definition | Chloroflexus sp. Y-400-fl chromosome, complete genome. |
|---|---|
| Accession | NC_012032 |
| Length | 5,268,950 |
Click here to switch to the map view.
The map label for this gene is yicI [C]
Identifier: 222526933
GI number: 222526933
Start: 4629279
End: 4631189
Strand: Reverse
Name: yicI [C]
Synonym: Chy400_3711
Alternate gene names: 222526933
Gene position: 4631189-4629279 (Counterclockwise)
Preceding gene: 222526936
Following gene: 222526932
Centisome position: 87.9
GC content: 60.28
Gene sequence:
>1911_bases ATGCAACATGTCATTCACAGCCCAGCCGGTACCGCCACGTTCGATGGTCACGGTCAGATCGTTTTTACTCACGAAGGCCG CACGGTCTTGTGCTGTCGAGGGGCGACGGCGTATGCCTACGGTACGGATATACCGACTACCGGCGTTGTAAGTGCTGATG TTACCGACCATCAGGCTCGTCTTCACTACGCGACCACGCGCCCAGAGGTGATACTGCGCCTGACAATTGAGACGACTCCC ATCGGCTTTCGCTTGAGCTGGTCTGGCCCGCCCCATCTGCCGGCACTGCGGGTTGAATGGCAGCTTGAACCAGGACGCCC CTGGTACGGTATGGGTGAGCGCGTGTTTCAGCATTGGCCGCTCGACCGTGGTGTGGTGATCTCCGATCCGTTCGAGCCAA TTGACCATGGTCGTGACGGTACGCTGAATATCGCGACTCCCTTTTGGGTAAATGCTGCCGGGGCTGCGATTTGGCTGGAA GAGGGTGATGGAGAGCTGGCAGTGACGATGAACCGCGACGGTGATGGGTTGTTACGTATCACTGCGCGCGAGGCACCACC GCCGCCTACGCTCGGCTTCGATGAACGCTATGCCGCGCCTGGCCCGGCCCTGGTTGCCCAGGTGATCCTGGCAGCCAATG CGCCGGCTGCGTTTTACACGGCACTGCCACTGTTGGGCCGACCGTCCGCTGCGCCACCGCTGGAGTTGTTTAGCCGCCCG ATCTGGACGACCTGGGCACATTATAAGATGCCGGTCACGCAACGGGATGTGTCCGATTTTGCAGCTCAGATCGTTGCCCG TGGTTATCCCTACTCGGTGCTGGAGATTGATGATCGCTGGCAACGGGGCTATGGGGCGTATGTGTTCGATCCGCGGAAGT TCCCCGATCCGCGGGCGATGGTGGATGAGCTGCACGCAGCCGGTTTTAAGGTGACGCTCTGGACACCAACGTTTTTCGAT CCGGCTGACCCAGCCTTTGCGGTCGCGGCACGGCGCGGCTATTTGATCCGTCATCCCGCCGATAATGCACCTTATCTGGT GCGGTGGTGGCAGGGCTACGGCGGTGTGCTCGATATGACCAATCCTGAAGCGGTGGCGTGGTGGCTCAGTGAACTACGTG CTCTTCAGGCAGAGACCGGGGTCGATGGGTTTAAGTTTGATGCCGGTGAAGCCAATTTTATCCCGCCCGATGCCATCTGT TACGCGCGCGAGCCGCGCCGTCGCTATGCCGACCGCTACACCGAATTTGTGGCCGATCACTTTGCCTATACCGAGGTGCG CGTCGGTTGGCGCGGTCAGCGGCGTGGCATTCTCTACCGCGAGTGGGATAAGTGGAGTCGCTGGGGGATTGATAATGGTC TGCACAGTGTGCTAACACAGGCGCTGACGCTCAGTCTGTGTGGTTATCCGTTTGTGCTGCCGGATATGATCGGCGGGAAT GCGTATCAGGATGAGGTGCCGGATGGCGAGCTGATGGTGCGCTGGACGCAACTCTGTGCGTTGTTGCCAACGATGCAATT CAGCGTTCATCCGTGGCAGTACGGCGCCGAGGTTGACGCTATTTGCCGCCAGTATGCGCAGCTCCACGTTGATCTGACGC CGTATCTGGCAACGCTGATCGAAGAGAATCTGCGCGACGGCACACCACTTGTGCGCCCCCTCTTCTGGTACGCGCCAACG GATACGCAGGCATTGCATTGCGATGATCAGTTCCTGCTCGGTGCTCGCTATCTGGTGGCACCGGTTGTCCGCCCTGGTCA GCGCCGGCGCGATGTCTACCTGCCGGCAGGCGTCTGGCGTGACTACTGGAGTGGTGCGATTCATCAAGGGCCAGTCGCTC TCACCGATGTACCGGCGCCGCTTGAGCAGATGCCGCTCTTCGAGCGACAGGATGAACGGTCGGGCCAATGA
Upstream 100 bases:
>100_bases TCTGTGGTGCAACCACCCCAGCGCTCTTCGGAGTTTGCCCCATACTTGCCGCTATCTGGTATCATCAGTGCGTGTACTGA AGTGATATGGAGATACGGTC
Downstream 100 bases:
>100_bases ACCGGTCAATCCCATAAAACAACAGAGCTGTGAGGTGTATATGCAGCACTCCGTTCGCGTTCATCGTAACGGCATCGAGC TTGATGGAAAACCCTTTTAT
Product: glycoside hydrolase family protein
Products: NA
Alternate protein names: Alpha-glucosidase II [H]
Number of amino acids: Translated: 636; Mature: 636
Protein sequence:
>636_residues MQHVIHSPAGTATFDGHGQIVFTHEGRTVLCCRGATAYAYGTDIPTTGVVSADVTDHQARLHYATTRPEVILRLTIETTP IGFRLSWSGPPHLPALRVEWQLEPGRPWYGMGERVFQHWPLDRGVVISDPFEPIDHGRDGTLNIATPFWVNAAGAAIWLE EGDGELAVTMNRDGDGLLRITAREAPPPPTLGFDERYAAPGPALVAQVILAANAPAAFYTALPLLGRPSAAPPLELFSRP IWTTWAHYKMPVTQRDVSDFAAQIVARGYPYSVLEIDDRWQRGYGAYVFDPRKFPDPRAMVDELHAAGFKVTLWTPTFFD PADPAFAVAARRGYLIRHPADNAPYLVRWWQGYGGVLDMTNPEAVAWWLSELRALQAETGVDGFKFDAGEANFIPPDAIC YAREPRRRYADRYTEFVADHFAYTEVRVGWRGQRRGILYREWDKWSRWGIDNGLHSVLTQALTLSLCGYPFVLPDMIGGN AYQDEVPDGELMVRWTQLCALLPTMQFSVHPWQYGAEVDAICRQYAQLHVDLTPYLATLIEENLRDGTPLVRPLFWYAPT DTQALHCDDQFLLGARYLVAPVVRPGQRRRDVYLPAGVWRDYWSGAIHQGPVALTDVPAPLEQMPLFERQDERSGQ
Sequences:
>Translated_636_residues MQHVIHSPAGTATFDGHGQIVFTHEGRTVLCCRGATAYAYGTDIPTTGVVSADVTDHQARLHYATTRPEVILRLTIETTP IGFRLSWSGPPHLPALRVEWQLEPGRPWYGMGERVFQHWPLDRGVVISDPFEPIDHGRDGTLNIATPFWVNAAGAAIWLE EGDGELAVTMNRDGDGLLRITAREAPPPPTLGFDERYAAPGPALVAQVILAANAPAAFYTALPLLGRPSAAPPLELFSRP IWTTWAHYKMPVTQRDVSDFAAQIVARGYPYSVLEIDDRWQRGYGAYVFDPRKFPDPRAMVDELHAAGFKVTLWTPTFFD PADPAFAVAARRGYLIRHPADNAPYLVRWWQGYGGVLDMTNPEAVAWWLSELRALQAETGVDGFKFDAGEANFIPPDAIC YAREPRRRYADRYTEFVADHFAYTEVRVGWRGQRRGILYREWDKWSRWGIDNGLHSVLTQALTLSLCGYPFVLPDMIGGN AYQDEVPDGELMVRWTQLCALLPTMQFSVHPWQYGAEVDAICRQYAQLHVDLTPYLATLIEENLRDGTPLVRPLFWYAPT DTQALHCDDQFLLGARYLVAPVVRPGQRRRDVYLPAGVWRDYWSGAIHQGPVALTDVPAPLEQMPLFERQDERSGQ >Mature_636_residues MQHVIHSPAGTATFDGHGQIVFTHEGRTVLCCRGATAYAYGTDIPTTGVVSADVTDHQARLHYATTRPEVILRLTIETTP IGFRLSWSGPPHLPALRVEWQLEPGRPWYGMGERVFQHWPLDRGVVISDPFEPIDHGRDGTLNIATPFWVNAAGAAIWLE EGDGELAVTMNRDGDGLLRITAREAPPPPTLGFDERYAAPGPALVAQVILAANAPAAFYTALPLLGRPSAAPPLELFSRP IWTTWAHYKMPVTQRDVSDFAAQIVARGYPYSVLEIDDRWQRGYGAYVFDPRKFPDPRAMVDELHAAGFKVTLWTPTFFD PADPAFAVAARRGYLIRHPADNAPYLVRWWQGYGGVLDMTNPEAVAWWLSELRALQAETGVDGFKFDAGEANFIPPDAIC YAREPRRRYADRYTEFVADHFAYTEVRVGWRGQRRGILYREWDKWSRWGIDNGLHSVLTQALTLSLCGYPFVLPDMIGGN AYQDEVPDGELMVRWTQLCALLPTMQFSVHPWQYGAEVDAICRQYAQLHVDLTPYLATLIEENLRDGTPLVRPLFWYAPT DTQALHCDDQFLLGARYLVAPVVRPGQRRRDVYLPAGVWRDYWSGAIHQGPVALTDVPAPLEQMPLFERQDERSGQ
Specific function: Unknown
COG id: COG1501
COG function: function code G; Alpha-glucosidases, family 31 of glycosyl hydrolases
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the glycosyl hydrolase 31 family [H]
Homologues:
Organism=Homo sapiens, GI153791946, Length=582, Percent_Identity=38.1443298969072, Blast_Score=338, Evalue=7e-93, Organism=Homo sapiens, GI88900491, Length=608, Percent_Identity=25.4934210526316, Blast_Score=106, Evalue=6e-23, Organism=Homo sapiens, GI38202257, Length=608, Percent_Identity=25.4934210526316, Blast_Score=106, Evalue=7e-23, Organism=Homo sapiens, GI66346737, Length=460, Percent_Identity=24.5652173913043, Blast_Score=103, Evalue=4e-22, Organism=Homo sapiens, GI119393895, Length=411, Percent_Identity=25.5474452554745, Blast_Score=102, Evalue=1e-21, Organism=Homo sapiens, GI119393893, Length=411, Percent_Identity=25.5474452554745, Blast_Score=102, Evalue=1e-21, Organism=Homo sapiens, GI119393891, Length=411, Percent_Identity=25.5474452554745, Blast_Score=102, Evalue=1e-21, Organism=Homo sapiens, GI310115361, Length=186, Percent_Identity=31.1827956989247, Blast_Score=78, Evalue=2e-14, Organism=Homo sapiens, GI221316699, Length=210, Percent_Identity=29.5238095238095, Blast_Score=75, Evalue=1e-13, Organism=Escherichia coli, GI2367256, Length=406, Percent_Identity=27.3399014778325, Blast_Score=124, Evalue=2e-29, Organism=Escherichia coli, GI2367323, Length=365, Percent_Identity=26.5753424657534, Blast_Score=122, Evalue=8e-29, Organism=Caenorhabditis elegans, GI17560798, Length=419, Percent_Identity=25.5369928400955, Blast_Score=100, Evalue=4e-21, Organism=Caenorhabditis elegans, GI17560800, Length=419, Percent_Identity=25.5369928400955, Blast_Score=99, Evalue=5e-21, Organism=Caenorhabditis elegans, GI71991189, Length=409, Percent_Identity=25.4278728606357, Blast_Score=94, Evalue=2e-19, Organism=Caenorhabditis elegans, GI71985706, Length=272, Percent_Identity=24.6323529411765, Blast_Score=73, Evalue=5e-13, Organism=Saccharomyces cerevisiae, GI6319706, Length=178, Percent_Identity=28.6516853932584, Blast_Score=75, Evalue=4e-14, Organism=Drosophila melanogaster, GI24650054, Length=537, Percent_Identity=34.8230912476723, Blast_Score=309, Evalue=3e-84, Organism=Drosophila melanogaster, GI28571440, Length=650, Percent_Identity=25.5384615384615, Blast_Score=172, Evalue=8e-43, Organism=Drosophila melanogaster, GI28571438, Length=650, Percent_Identity=25.5384615384615, Blast_Score=171, Evalue=1e-42, Organism=Drosophila melanogaster, GI24643749, Length=496, Percent_Identity=22.5806451612903, Blast_Score=83, Evalue=5e-16, Organism=Drosophila melanogaster, GI24643753, Length=496, Percent_Identity=22.5806451612903, Blast_Score=83, Evalue=5e-16, Organism=Drosophila melanogaster, GI24643751, Length=496, Percent_Identity=22.5806451612903, Blast_Score=83, Evalue=5e-16, Organism=Drosophila melanogaster, GI24643746, Length=496, Percent_Identity=22.5806451612903, Blast_Score=83, Evalue=5e-16, Organism=Drosophila melanogaster, GI21357605, Length=496, Percent_Identity=22.5806451612903, Blast_Score=83, Evalue=5e-16,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR013785 - InterPro: IPR011013 - InterPro: IPR000322 - InterPro: IPR017853 [H]
Pfam domain/function: PF01055 Glyco_hydro_31 [H]
EC number: =3.2.1.20 [H]
Molecular weight: Translated: 71521; Mature: 71521
Theoretical pI: Translated: 5.57; Mature: 5.57
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.1 %Cys (Translated Protein) 1.6 %Met (Translated Protein) 2.7 %Cys+Met (Translated Protein) 1.1 %Cys (Mature Protein) 1.6 %Met (Mature Protein) 2.7 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MQHVIHSPAGTATFDGHGQIVFTHEGRTVLCCRGATAYAYGTDIPTTGVVSADVTDHQAR CCCEECCCCCCCEECCCCEEEEEECCCEEEEECCCEEEEECCCCCCCCEEECCCCCCCEE LHYATTRPEVILRLTIETTPIGFRLSWSGPPHLPALRVEWQLEPGRPWYGMGERVFQHWP EEEECCCCEEEEEEEEEECCCEEEEECCCCCCCCEEEEEEEECCCCCCCCCHHHHHHHCC LDRGVVISDPFEPIDHGRDGTLNIATPFWVNAAGAAIWLEEGDGELAVTMNRDGDGLLRI CCCCEEECCCCCHHHCCCCCEEEECCCCEEECCCEEEEEEECCCEEEEEEECCCCCEEEE TAREAPPPPTLGFDERYAAPGPALVAQVILAANAPAAFYTALPLLGRPSAAPPLELFSRP EECCCCCCCCCCCCCCCCCCCHHHHHHHHHHCCCCHHHHHHHHHCCCCCCCCCHHHHCCC IWTTWAHYKMPVTQRDVSDFAAQIVARGYPYSVLEIDDRWQRGYGAYVFDPRKFPDPRAM CEECEEEEECCCCHHHHHHHHHHHHHCCCCEEEEEECCHHHCCCCEEEECCCCCCCHHHH VDELHAAGFKVTLWTPTFFDPADPAFAVAARRGYLIRHPADNAPYLVRWWQGYGGVLDMT HHHHHHCCEEEEEECCCCCCCCCCHHHHHHHCCEEEECCCCCCCEEEEEECCCCCEEECC NPEAVAWWLSELRALQAETGVDGFKFDAGEANFIPPDAICYAREPRRRYADRYTEFVADH CCHHHHHHHHHHHHHHHHCCCCCEEECCCCCCCCCCCCEEECCCHHHHHHHHHHHHHHHH FAYTEVRVGWRGQRRGILYREWDKWSRWGIDNGLHSVLTQALTLSLCGYPFVLPDMIGGN HEEEEEEECCCCCCCCCEEEECCCHHHCCCCHHHHHHHHHHHHHHHCCCCEECHHHCCCC AYQDEVPDGELMVRWTQLCALLPTMQFSVHPWQYGAEVDAICRQYAQLHVDLTPYLATLI CCCCCCCCCHHHHHHHHHHHHHHHHHEEECCHHCCCCHHHHHHHHHHEEECHHHHHHHHH EENLRDGTPLVRPLFWYAPTDTQALHCDDQFLLGARYLVAPVVRPGQRRRDVYLPAGVWR HHHHCCCCCCCCEEEEECCCCCCEEECCCHHHHCCHHHHHHCCCCCCCCCEEEECCHHHH DYWSGAIHQGPVALTDVPAPLEQMPLFERQDERSGQ HHHCCCCCCCCEEEECCCCCHHHCCCCCCCHHCCCC >Mature Secondary Structure MQHVIHSPAGTATFDGHGQIVFTHEGRTVLCCRGATAYAYGTDIPTTGVVSADVTDHQAR CCCEECCCCCCCEECCCCEEEEEECCCEEEEECCCEEEEECCCCCCCCEEECCCCCCCEE LHYATTRPEVILRLTIETTPIGFRLSWSGPPHLPALRVEWQLEPGRPWYGMGERVFQHWP EEEECCCCEEEEEEEEEECCCEEEEECCCCCCCCEEEEEEEECCCCCCCCCHHHHHHHCC LDRGVVISDPFEPIDHGRDGTLNIATPFWVNAAGAAIWLEEGDGELAVTMNRDGDGLLRI CCCCEEECCCCCHHHCCCCCEEEECCCCEEECCCEEEEEEECCCEEEEEEECCCCCEEEE TAREAPPPPTLGFDERYAAPGPALVAQVILAANAPAAFYTALPLLGRPSAAPPLELFSRP EECCCCCCCCCCCCCCCCCCCHHHHHHHHHHCCCCHHHHHHHHHCCCCCCCCCHHHHCCC IWTTWAHYKMPVTQRDVSDFAAQIVARGYPYSVLEIDDRWQRGYGAYVFDPRKFPDPRAM CEECEEEEECCCCHHHHHHHHHHHHHCCCCEEEEEECCHHHCCCCEEEECCCCCCCHHHH VDELHAAGFKVTLWTPTFFDPADPAFAVAARRGYLIRHPADNAPYLVRWWQGYGGVLDMT HHHHHHCCEEEEEECCCCCCCCCCHHHHHHHCCEEEECCCCCCCEEEEEECCCCCEEECC NPEAVAWWLSELRALQAETGVDGFKFDAGEANFIPPDAICYAREPRRRYADRYTEFVADH CCHHHHHHHHHHHHHHHHCCCCCEEECCCCCCCCCCCCEEECCCHHHHHHHHHHHHHHHH FAYTEVRVGWRGQRRGILYREWDKWSRWGIDNGLHSVLTQALTLSLCGYPFVLPDMIGGN HEEEEEEECCCCCCCCCEEEECCCHHHCCCCHHHHHHHHHHHHHHHCCCCEECHHHCCCC AYQDEVPDGELMVRWTQLCALLPTMQFSVHPWQYGAEVDAICRQYAQLHVDLTPYLATLI CCCCCCCCCHHHHHHHHHHHHHHHHHEEECCHHCCCCHHHHHHHHHHEEECHHHHHHHHH EENLRDGTPLVRPLFWYAPTDTQALHCDDQFLLGARYLVAPVVRPGQRRRDVYLPAGVWR HHHHCCCCCCCCEEEEECCCCCCEEECCCHHHHCCHHHHHHCCCCCCCCCEEEECCHHHH DYWSGAIHQGPVALTDVPAPLEQMPLFERQDERSGQ HHHCCCCCCCCEEEECCCCCHHHCCCCCCCHHCCCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 10945254 [H]