| Definition | Chloroflexus sp. Y-400-fl chromosome, complete genome. |
|---|---|
| Accession | NC_012032 |
| Length | 5,268,950 |
Click here to switch to the map view.
The map label for this gene is treC [C]
Identifier: 222523845
GI number: 222523845
Start: 660343
End: 662094
Strand: Direct
Name: treC [C]
Synonym: Chy400_0553
Alternate gene names: 222523845
Gene position: 660343-662094 (Clockwise)
Preceding gene: 222523844
Following gene: 222523846
Centisome position: 12.53
GC content: 55.82
Gene sequence:
>1752_bases ATGCATCGAATAATTGTTACCCTGCTTACCATCAGTGTACTCGTTGCCTGTGGTGCGCCAGCAGCCGGGCCAACCGCACC GGCTGCATCGCCCACCGTAGCCGGCACCCCGACCAATTCGCGTCCGCCAACGCCAACCCGTGATCCGCGCCTGCCAACCT TGCCGCCGCGTATAACGCCCGGCCCTACGGCCACACCTTTTCCGCTTGAAGCCGGCTGGTGGGATGGGGCTGTCTGTTAT GAAATTTTCGTGCGCTCGTTTTACGATAGCGACGGCGACGGCAACGGTGATCTGAACGGCATTATCGCCAAACTTGACTA TCTCAATGATGGCGATCCCAACACGACCACCGATCTGGGCATCAATTGTATCTGGCTGATGCCGGTCGCCGAAGCTGCCA GTTATCACGGCTACGACACGATTGACTATTACACGGTCGAACGCGACTACGGCACCAATGAGGATTTCAAGCGTCTGGTT GCCGAAGCGGAACGGCGCGGGATTAAAATCATCATCGATTTAGTACTGAACCATACCAGTACCCAACACCCGTGGTTTCA AGAGGCATTACGCGACCCCAACTCACCGTACCGCGACTGGTATTTGTGGTCGGCGATTGACCCTGGCTATCGTGGCCCAT TCGGCAACAATGTGGTCTGGCACAAATCACCCATTCGTGATGAATATTATTACGGCGTGTTCTGGGGTGGTATGCCCGAT CTCAACTATCGCAATCCGGCAGTCACTGCCGAAGCCTACAAGATTGCTCGCTTTTGGGTTGAAGAGATGGGGGTTGCCGG CTTCCGTCTCGACGCGATCAAGCATCTGATCGAATATTACACTCTCCAGGAAGACACCGTCGAGACCTTTGAATGGTTGC GCGAGTTTCGACGTTTTCTCGACCGGGAACTACCCGGAACCTTCACGATTGGCGAAGTCTTCAACGGCAACCCGCGCACG CTGGCACCGTACTATCCTGACCAGCTCGATTACTATTTCGAGTTTGAAGTCGCCAATCAGATTCGCGGCGCGGCCAACAC CGGTCTATCGCGATTGTTTATGCAGGCGGTGCAGGATGCCTACACAAAACTACCCTATCAACGCTGGGCACCCTTCCTGA CCAATCACGACCAGAACCGCGTGATGTCGGTGTTGGGTGATGACGTGGCGAAGGCAAAACTGGCTGCGCTGGCTCTGCTG ACCATGCCGGGACTGCCCTTCATCTATTATGGTGAAGAGATCGGCATGCTGGGGGTGAAACCGGATGAGCGTATTCGCAC CCCAATGCAGTGGACGAAGGAGGAGTTTGGCGGATTCTCAGCCGGTATTCCCTGGCAGCAGCCGCAGAGCGATTACCCGG TCAAGAATGTGATGTTACAAGACCAGGATCCCGAATCGCTGCTCAACACCTACCGGCAGTTAATTCATCTCCACGTGAAT ACACCGGCACTGGCGACCGGTGATTTCTGGCCGTTAACTGCTAACGGTGCCAGTGTCGCCGCGTACATCAGGCGCAGTGG TGAAGACATGGTTTTGGTGGTGATTAATTTTGACAAAGTACCCACGCCACCGTTTACACTATCATCAGGTGAGAGCGACC TGCCGGCAGGCACCTACCAGGTGACCGCACTCTTCGGCACGCCACCGGCACCGCCGGTGCCGCTTACCATCGCCGACGGG CGTATCGTGGAGTATCAACCGGGGATCGAAATACCGGCTCAAACCGGATACATATTCAGGTTGGAGCGCTAA
Upstream 100 bases:
>100_bases CAGGGTTGCGTCGTCTGTTCATGCAGAGTGACGAGTCAACACCTGCGCAAAATCCGGTATAATGCAACAAACGCATTAAT TGACAAAGAAACGGTTTCCT
Downstream 100 bases:
>100_bases TGTTACGAAAAGTAACTGCAACTCGTTATGTCACACCGTTGCGTGAAGGCGGTTCATTACCGGCGATTGTCGAAGCCGAT GATGATGGCCTGTACGTCGT
Product: alpha amylase catalytic subunit
Products: NA
Alternate protein names: 1,4-alpha-D-glucan glucanohydrolase [H]
Number of amino acids: Translated: 583; Mature: 583
Protein sequence:
>583_residues MHRIIVTLLTISVLVACGAPAAGPTAPAASPTVAGTPTNSRPPTPTRDPRLPTLPPRITPGPTATPFPLEAGWWDGAVCY EIFVRSFYDSDGDGNGDLNGIIAKLDYLNDGDPNTTTDLGINCIWLMPVAEAASYHGYDTIDYYTVERDYGTNEDFKRLV AEAERRGIKIIIDLVLNHTSTQHPWFQEALRDPNSPYRDWYLWSAIDPGYRGPFGNNVVWHKSPIRDEYYYGVFWGGMPD LNYRNPAVTAEAYKIARFWVEEMGVAGFRLDAIKHLIEYYTLQEDTVETFEWLREFRRFLDRELPGTFTIGEVFNGNPRT LAPYYPDQLDYYFEFEVANQIRGAANTGLSRLFMQAVQDAYTKLPYQRWAPFLTNHDQNRVMSVLGDDVAKAKLAALALL TMPGLPFIYYGEEIGMLGVKPDERIRTPMQWTKEEFGGFSAGIPWQQPQSDYPVKNVMLQDQDPESLLNTYRQLIHLHVN TPALATGDFWPLTANGASVAAYIRRSGEDMVLVVINFDKVPTPPFTLSSGESDLPAGTYQVTALFGTPPAPPVPLTIADG RIVEYQPGIEIPAQTGYIFRLER
Sequences:
>Translated_583_residues MHRIIVTLLTISVLVACGAPAAGPTAPAASPTVAGTPTNSRPPTPTRDPRLPTLPPRITPGPTATPFPLEAGWWDGAVCY EIFVRSFYDSDGDGNGDLNGIIAKLDYLNDGDPNTTTDLGINCIWLMPVAEAASYHGYDTIDYYTVERDYGTNEDFKRLV AEAERRGIKIIIDLVLNHTSTQHPWFQEALRDPNSPYRDWYLWSAIDPGYRGPFGNNVVWHKSPIRDEYYYGVFWGGMPD LNYRNPAVTAEAYKIARFWVEEMGVAGFRLDAIKHLIEYYTLQEDTVETFEWLREFRRFLDRELPGTFTIGEVFNGNPRT LAPYYPDQLDYYFEFEVANQIRGAANTGLSRLFMQAVQDAYTKLPYQRWAPFLTNHDQNRVMSVLGDDVAKAKLAALALL TMPGLPFIYYGEEIGMLGVKPDERIRTPMQWTKEEFGGFSAGIPWQQPQSDYPVKNVMLQDQDPESLLNTYRQLIHLHVN TPALATGDFWPLTANGASVAAYIRRSGEDMVLVVINFDKVPTPPFTLSSGESDLPAGTYQVTALFGTPPAPPVPLTIADG RIVEYQPGIEIPAQTGYIFRLER >Mature_583_residues MHRIIVTLLTISVLVACGAPAAGPTAPAASPTVAGTPTNSRPPTPTRDPRLPTLPPRITPGPTATPFPLEAGWWDGAVCY EIFVRSFYDSDGDGNGDLNGIIAKLDYLNDGDPNTTTDLGINCIWLMPVAEAASYHGYDTIDYYTVERDYGTNEDFKRLV AEAERRGIKIIIDLVLNHTSTQHPWFQEALRDPNSPYRDWYLWSAIDPGYRGPFGNNVVWHKSPIRDEYYYGVFWGGMPD LNYRNPAVTAEAYKIARFWVEEMGVAGFRLDAIKHLIEYYTLQEDTVETFEWLREFRRFLDRELPGTFTIGEVFNGNPRT LAPYYPDQLDYYFEFEVANQIRGAANTGLSRLFMQAVQDAYTKLPYQRWAPFLTNHDQNRVMSVLGDDVAKAKLAALALL TMPGLPFIYYGEEIGMLGVKPDERIRTPMQWTKEEFGGFSAGIPWQQPQSDYPVKNVMLQDQDPESLLNTYRQLIHLHVN TPALATGDFWPLTANGASVAAYIRRSGEDMVLVVINFDKVPTPPFTLSSGESDLPAGTYQVTALFGTPPAPPVPLTIADG RIVEYQPGIEIPAQTGYIFRLER
Specific function: Unknown
COG id: COG0366
COG function: function code G; Glycosidases
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the glycosyl hydrolase 13 family [H]
Homologues:
Organism=Homo sapiens, GI187423904, Length=527, Percent_Identity=31.4990512333966, Blast_Score=202, Evalue=8e-52, Organism=Escherichia coli, GI1790687, Length=527, Percent_Identity=32.258064516129, Blast_Score=224, Evalue=2e-59, Organism=Escherichia coli, GI1786604, Length=514, Percent_Identity=26.6536964980545, Blast_Score=131, Evalue=1e-31, Organism=Caenorhabditis elegans, GI32565753, Length=539, Percent_Identity=23.747680890538, Blast_Score=121, Evalue=1e-27, Organism=Caenorhabditis elegans, GI25147709, Length=450, Percent_Identity=25.7777777777778, Blast_Score=97, Evalue=2e-20, Organism=Saccharomyces cerevisiae, GI6322245, Length=395, Percent_Identity=29.3670886075949, Blast_Score=154, Evalue=3e-38, Organism=Saccharomyces cerevisiae, GI6321726, Length=559, Percent_Identity=24.6869409660107, Blast_Score=150, Evalue=4e-37, Organism=Saccharomyces cerevisiae, GI6321731, Length=540, Percent_Identity=25.5555555555556, Blast_Score=149, Evalue=2e-36, Organism=Saccharomyces cerevisiae, GI6319776, Length=540, Percent_Identity=25.3703703703704, Blast_Score=147, Evalue=5e-36, Organism=Saccharomyces cerevisiae, GI6322241, Length=557, Percent_Identity=25.1346499102334, Blast_Score=144, Evalue=6e-35, Organism=Saccharomyces cerevisiae, GI6322021, Length=557, Percent_Identity=25.1346499102334, Blast_Score=144, Evalue=6e-35, Organism=Saccharomyces cerevisiae, GI6324416, Length=555, Percent_Identity=25.2252252252252, Blast_Score=143, Evalue=7e-35, Organism=Drosophila melanogaster, GI45549022, Length=524, Percent_Identity=30.3435114503817, Blast_Score=207, Evalue=2e-53, Organism=Drosophila melanogaster, GI221330053, Length=571, Percent_Identity=29.2469352014011, Blast_Score=197, Evalue=2e-50, Organism=Drosophila melanogaster, GI24583747, Length=476, Percent_Identity=32.3529411764706, Blast_Score=194, Evalue=2e-49, Organism=Drosophila melanogaster, GI24583749, Length=476, Percent_Identity=32.3529411764706, Blast_Score=193, Evalue=2e-49, Organism=Drosophila melanogaster, GI24583745, Length=513, Percent_Identity=30.7992202729045, Blast_Score=192, Evalue=5e-49, Organism=Drosophila melanogaster, GI24586599, Length=533, Percent_Identity=30.5816135084428, Blast_Score=192, Evalue=7e-49, Organism=Drosophila melanogaster, GI24586589, Length=524, Percent_Identity=31.2977099236641, Blast_Score=189, Evalue=4e-48, Organism=Drosophila melanogaster, GI24586593, Length=534, Percent_Identity=31.2734082397004, Blast_Score=185, Evalue=8e-47, Organism=Drosophila melanogaster, GI24586591, Length=537, Percent_Identity=30.3538175046555, Blast_Score=184, Evalue=2e-46, Organism=Drosophila melanogaster, GI24586597, Length=526, Percent_Identity=30.0380228136882, Blast_Score=181, Evalue=1e-45, Organism=Drosophila melanogaster, GI24586587, Length=477, Percent_Identity=29.979035639413, Blast_Score=180, Evalue=2e-45, Organism=Drosophila melanogaster, GI281360393, Length=473, Percent_Identity=30.4439746300211, Blast_Score=139, Evalue=4e-33,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR013780 - InterPro: IPR006047 - InterPro: IPR006589 - InterPro: IPR017853 - InterPro: IPR013781 [H]
Pfam domain/function: PF00128 Alpha-amylase [H]
EC number: =3.2.1.1 [H]
Molecular weight: Translated: 65452; Mature: 65452
Theoretical pI: Translated: 4.60; Mature: 4.60
Prosite motif: PS00013 PROKAR_LIPOPROTEIN
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.5 %Cys (Translated Protein) 1.9 %Met (Translated Protein) 2.4 %Cys+Met (Translated Protein) 0.5 %Cys (Mature Protein) 1.9 %Met (Mature Protein) 2.4 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MHRIIVTLLTISVLVACGAPAAGPTAPAASPTVAGTPTNSRPPTPTRDPRLPTLPPRITP CCHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC GPTATPFPLEAGWWDGAVCYEIFVRSFYDSDGDGNGDLNGIIAKLDYLNDGDPNTTTDLG CCCCCCCCCCCCCCCCHHHHHHHHHHHCCCCCCCCCCCCEEEEEEECCCCCCCCCCHHCC INCIWLMPVAEAASYHGYDTIDYYTVERDYGTNEDFKRLVAEAERRGIKIIIDLVLNHTS CEEEEEEEHHHHHCCCCCCCEEEEEEECCCCCCHHHHHHHHHHHHCCEEEEEEEHHCCCC TQHPWFQEALRDPNSPYRDWYLWSAIDPGYRGPFGNNVVWHKSPIRDEYYYGVFWGGMPD CCCCHHHHHHCCCCCCCCCEEEEECCCCCCCCCCCCCEEECCCCCCCCEEEEEEECCCCC LNYRNPAVTAEAYKIARFWVEEMGVAGFRLDAIKHLIEYYTLQEDTVETFEWLREFRRFL CCCCCCCCHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHH DRELPGTFTIGEVFNGNPRTLAPYYPDQLDYYFEFEVANQIRGAANTGLSRLFMQAVQDA HHCCCCCEEECCEECCCCCEECCCCCCCCCEEEEEEEHHHHCCHHHHHHHHHHHHHHHHH YTKLPYQRWAPFLTNHDQNRVMSVLGDDVAKAKLAALALLTMPGLPFIYYGEEIGMLGVK HHHCCHHHCCCHHCCCCHHHHHHHHCCHHHHHHHHHHHHHHCCCCCEEEECCCCCEECCC PDERIRTPMQWTKEEFGGFSAGIPWQQPQSDYPVKNVMLQDQDPESLLNTYRQLIHLHVN CHHHHCCCHHHHHHHHCCCCCCCCCCCCCCCCCHHHEEECCCCHHHHHHHHHHHEEEEEC TPALATGDFWPLTANGASVAAYIRRSGEDMVLVVINFDKVPTPPFTLSSGESDLPAGTYQ CCCEECCCCCEEECCCCHHHHHHHCCCCCEEEEEEECCCCCCCCEEECCCCCCCCCCCEE VTALFGTPPAPPVPLTIADGRIVEYQPGIEIPAQTGYIFRLER EEEEECCCCCCCEEEEECCCEEEEECCCCCCCCCCCEEEEECC >Mature Secondary Structure MHRIIVTLLTISVLVACGAPAAGPTAPAASPTVAGTPTNSRPPTPTRDPRLPTLPPRITP CCHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC GPTATPFPLEAGWWDGAVCYEIFVRSFYDSDGDGNGDLNGIIAKLDYLNDGDPNTTTDLG CCCCCCCCCCCCCCCCHHHHHHHHHHHCCCCCCCCCCCCEEEEEEECCCCCCCCCCHHCC INCIWLMPVAEAASYHGYDTIDYYTVERDYGTNEDFKRLVAEAERRGIKIIIDLVLNHTS CEEEEEEEHHHHHCCCCCCCEEEEEEECCCCCCHHHHHHHHHHHHCCEEEEEEEHHCCCC TQHPWFQEALRDPNSPYRDWYLWSAIDPGYRGPFGNNVVWHKSPIRDEYYYGVFWGGMPD CCCCHHHHHHCCCCCCCCCEEEEECCCCCCCCCCCCCEEECCCCCCCCEEEEEEECCCCC LNYRNPAVTAEAYKIARFWVEEMGVAGFRLDAIKHLIEYYTLQEDTVETFEWLREFRRFL CCCCCCCCHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHH DRELPGTFTIGEVFNGNPRTLAPYYPDQLDYYFEFEVANQIRGAANTGLSRLFMQAVQDA HHCCCCCEEECCEECCCCCEECCCCCCCCCEEEEEEEHHHHCCHHHHHHHHHHHHHHHHH YTKLPYQRWAPFLTNHDQNRVMSVLGDDVAKAKLAALALLTMPGLPFIYYGEEIGMLGVK HHHCCHHHCCCHHCCCCHHHHHHHHCCHHHHHHHHHHHHHHCCCCCEEEECCCCCEECCC PDERIRTPMQWTKEEFGGFSAGIPWQQPQSDYPVKNVMLQDQDPESLLNTYRQLIHLHVN CHHHHCCCHHHHHHHHCCCCCCCCCCCCCCCCCHHHEEECCCCHHHHHHHHHHHEEEEEC TPALATGDFWPLTANGASVAAYIRRSGEDMVLVVINFDKVPTPPFTLSSGESDLPAGTYQ CCCEECCCCCEEECCCCHHHHHHHCCCCCEEEEEEECCCCCCCCEEECCCCCCCCCCCEE VTALFGTPPAPPVPLTIADGRIVEYQPGIEIPAQTGYIFRLER EEEEECCCCCCCEEEEECCCEEEEECCCCCCCCCCCEEEEECC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 2455281 [H]