| Definition | Sulfolobus solfataricus P2 chromosome, complete genome. |
|---|---|
| Accession | NC_002754 |
| Length | 2,992,245 |
Click here to switch to the map view.
The map label for this gene is cutA-1 [H]
Identifier: 15898062
GI number: 15898062
Start: 1047747
End: 1049813
Strand: Direct
Name: cutA-1 [H]
Synonym: SSO1209
Alternate gene names: 15898062
Gene position: 1047747-1049813 (Clockwise)
Preceding gene: 15898057
Following gene: 15898066
Centisome position: 35.02
GC content: 39.77
Gene sequence:
>2067_bases ATGATACAAGAGCATTTACCTCTTATAACTGGCAAAGGTAGTTATATAGATGATATTAATCCGAAGAATGTAGTTTACCT TCACATAATTAGATCTCCAATAGCTAGGGGTATAATAAAGAGTATATCCAAACCGGAAAGCGCACTCTTATCGTTAACAT GGGAAGATGTGAAATTATACATGCCAGTGAGGCTATTTCCAGACCTAGCTAAAACTGCACAAGTTGCTAAAATGCCAGTA TTGGCTGATGGTAGGGTCAACTTCGTAGGTCAACCAATTTTAGCATTTGTGGTTGAAGATAGGTACAGGACTGAGGACGT TGCAGAGGAAGTTTTAATTGATTATGACGAATTAAAGCCAGTAGTTGATCCTGAGGAATCCTTAAATGCGGATCCCATTC ATCCAGGTTTAAAAAGTAACATCTCCATAGATCAACTTTTAGAAGGGGGAAACTTATCATTAAAAAATAAGGCTGAGGTT GTTGTAAGTAGGAAACTTAAGCAACAAAGGGTAGTTTCAAATCCAATGGAACCAAAAGGTTTCATCTGTTGGTGGGATAA TGATATACTAAACGTTTACGTTTCCACACAAGCACCGTTTGGAGTAAAGAATGATCTAAGGGAAATTTTAGGTATTTCTC CAGAAAAGATAAGAGTTTATTCCGCGCCTAACGTAGGAGGAGGATTTGGGAATAAGAGTGGGGGATACCCAGAATATGTC CTAGCAGCGATAGCTTCCTTGAAGCTTGGTAGGCCAGTTAAATGGATAGAAACTAGAAGTGAAATGCTAGTCAATACTCA ATCCTTAGGTAGAGGGGAGGTATCAGATATGAGACTTTATGCTACCAAGGACGGTGAGATTTTAGGAATAGAAGGCACTA TAATAGCAAATATAGGTGCTTTCGATTACGGAATAGGCTTCATTGCTCCTTTATTTATTGCGAGACTATCTAATGGTCCC TATAAGATGAAATTCGCATCGATAAGAGCAATGGGAGTATTTACTAACACTCCTCCAATGGGATTTTATAGGGGTGCTGG TAGACCAGAGGCTGCTTTAATTCATGAGACTTTGGTTGAGGATTTGGCTGAGGAGTTGGGTGTGGATTCTGTTGAGATTA GGAGGAGGAATTTGATTGGTGATAATGGTTATGTTACTCCTTTGGGTGTTAGGATTGATCCTGCTGGTTATAATGAGGTG TTGAATGAGGCTGAGAAGTATTATAGGAAGGCTAAGGAGGTTTATAAGGACAAGGGAGTTTCAATAGTTACGTTCGCCGA GATAGTCAGAACTTCGCCAGGTGAAGGTGCTAGAGTTAAGATAGAAAACGGTAAAGTACATTTTTACTTGGGAATAGGTC CACATGGTCAAGCTTATGGTAGCACATTCAAGAGACTGGCATCTGAAGTACTAGGTATAAGTGAAGATAAAATAGAGATA ACTACTGGTAGTTCTGAGATAGTTAAAGAGGGAATAGGTAGTTTCGGTTCTAGGGCAGGCACTATAGGAGGTTCTGCCGT GATAGCTGCTGCAACTGAATTACTCAAGAAGTTGAATACTAATTCTTTAAATGAGAGTGAACTAGTTAAGTATGAAGGTG TTGAGGCTGAAGTGTTCTATAAAGCTGATGATATCTTTGCCCCAGGAGCTCACGTAGCTGTAATTGATGTAGATAAGGAG ACTGGATTTATTAGAGTTTTGGAGTATTACGCTGTTGATGATGTTGGTAGAGCTATGAATAAGGAAGAGATAGAGGGACA AATAATTGGAAGTGTCCTACAAGGGGCATCACAAGTTATAATTGAAGCTATGAGATATGATGAGAGGGGAATCCCATTAT GTTCCTCAATTGCAGATTGTGGAGTTCCAACAGCTTTGGAAGCTCCTTTAAAGGTAAAAACTGAGTATATAGAGTATCCC TCTCAGCTTTTGTCCAGAAGTAGAGGTGTAGGAGAGGCCGGCACGACCGGCGCTTTACCAGCTGTTTTCATAGCAGTGGA AAAGGTTACTAAAAAGAAGTTTGATAGAACCCCCGTAGATCCTTGGATATTAGTTTCCTCTACATAA
Upstream 100 bases:
>100_bases CGTTTAGTCAGATAATTTTTATATTCTGATTAAAATATGATATTATGATAGTATGAAATACGCGGAAAGATTTAATTAGT TAGTTTACGTAATAACTTTC
Downstream 100 bases:
>100_bases TAAGGTGTACGATTATAGATCAATAAATGGAAAAAGAGATTTATAGCCTTTAGCGATATATAACTGAGGTTTTCAAAATT ATATACTGTCGTTATCATAA
Product: carbon monoxide dehydrogenase, large chain (cutA-1)
Products: NA
Alternate protein names: CO dehydrogenase subunit L; CO-DH L [H]
Number of amino acids: Translated: 688; Mature: 688
Protein sequence:
>688_residues MIQEHLPLITGKGSYIDDINPKNVVYLHIIRSPIARGIIKSISKPESALLSLTWEDVKLYMPVRLFPDLAKTAQVAKMPV LADGRVNFVGQPILAFVVEDRYRTEDVAEEVLIDYDELKPVVDPEESLNADPIHPGLKSNISIDQLLEGGNLSLKNKAEV VVSRKLKQQRVVSNPMEPKGFICWWDNDILNVYVSTQAPFGVKNDLREILGISPEKIRVYSAPNVGGGFGNKSGGYPEYV LAAIASLKLGRPVKWIETRSEMLVNTQSLGRGEVSDMRLYATKDGEILGIEGTIIANIGAFDYGIGFIAPLFIARLSNGP YKMKFASIRAMGVFTNTPPMGFYRGAGRPEAALIHETLVEDLAEELGVDSVEIRRRNLIGDNGYVTPLGVRIDPAGYNEV LNEAEKYYRKAKEVYKDKGVSIVTFAEIVRTSPGEGARVKIENGKVHFYLGIGPHGQAYGSTFKRLASEVLGISEDKIEI TTGSSEIVKEGIGSFGSRAGTIGGSAVIAAATELLKKLNTNSLNESELVKYEGVEAEVFYKADDIFAPGAHVAVIDVDKE TGFIRVLEYYAVDDVGRAMNKEEIEGQIIGSVLQGASQVIIEAMRYDERGIPLCSSIADCGVPTALEAPLKVKTEYIEYP SQLLSRSRGVGEAGTTGALPAVFIAVEKVTKKKFDRTPVDPWILVSST
Sequences:
>Translated_688_residues MIQEHLPLITGKGSYIDDINPKNVVYLHIIRSPIARGIIKSISKPESALLSLTWEDVKLYMPVRLFPDLAKTAQVAKMPV LADGRVNFVGQPILAFVVEDRYRTEDVAEEVLIDYDELKPVVDPEESLNADPIHPGLKSNISIDQLLEGGNLSLKNKAEV VVSRKLKQQRVVSNPMEPKGFICWWDNDILNVYVSTQAPFGVKNDLREILGISPEKIRVYSAPNVGGGFGNKSGGYPEYV LAAIASLKLGRPVKWIETRSEMLVNTQSLGRGEVSDMRLYATKDGEILGIEGTIIANIGAFDYGIGFIAPLFIARLSNGP YKMKFASIRAMGVFTNTPPMGFYRGAGRPEAALIHETLVEDLAEELGVDSVEIRRRNLIGDNGYVTPLGVRIDPAGYNEV LNEAEKYYRKAKEVYKDKGVSIVTFAEIVRTSPGEGARVKIENGKVHFYLGIGPHGQAYGSTFKRLASEVLGISEDKIEI TTGSSEIVKEGIGSFGSRAGTIGGSAVIAAATELLKKLNTNSLNESELVKYEGVEAEVFYKADDIFAPGAHVAVIDVDKE TGFIRVLEYYAVDDVGRAMNKEEIEGQIIGSVLQGASQVIIEAMRYDERGIPLCSSIADCGVPTALEAPLKVKTEYIEYP SQLLSRSRGVGEAGTTGALPAVFIAVEKVTKKKFDRTPVDPWILVSST >Mature_688_residues MIQEHLPLITGKGSYIDDINPKNVVYLHIIRSPIARGIIKSISKPESALLSLTWEDVKLYMPVRLFPDLAKTAQVAKMPV LADGRVNFVGQPILAFVVEDRYRTEDVAEEVLIDYDELKPVVDPEESLNADPIHPGLKSNISIDQLLEGGNLSLKNKAEV VVSRKLKQQRVVSNPMEPKGFICWWDNDILNVYVSTQAPFGVKNDLREILGISPEKIRVYSAPNVGGGFGNKSGGYPEYV LAAIASLKLGRPVKWIETRSEMLVNTQSLGRGEVSDMRLYATKDGEILGIEGTIIANIGAFDYGIGFIAPLFIARLSNGP YKMKFASIRAMGVFTNTPPMGFYRGAGRPEAALIHETLVEDLAEELGVDSVEIRRRNLIGDNGYVTPLGVRIDPAGYNEV LNEAEKYYRKAKEVYKDKGVSIVTFAEIVRTSPGEGARVKIENGKVHFYLGIGPHGQAYGSTFKRLASEVLGISEDKIEI TTGSSEIVKEGIGSFGSRAGTIGGSAVIAAATELLKKLNTNSLNESELVKYEGVEAEVFYKADDIFAPGAHVAVIDVDKE TGFIRVLEYYAVDDVGRAMNKEEIEGQIIGSVLQGASQVIIEAMRYDERGIPLCSSIADCGVPTALEAPLKVKTEYIEYP SQLLSRSRGVGEAGTTGALPAVFIAVEKVTKKKFDRTPVDPWILVSST
Specific function: Catalyzes the oxidation of carbon monoxide to carbon dioxide [H]
COG id: COG1529
COG function: function code C; Aerobic-type carbon monoxide dehydrogenase, large subunit CoxL/CutL homologs
Gene ontology:
Cell location: Cytoplasmic
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: NA
Homologues:
Organism=Homo sapiens, GI71773480, Length=757, Percent_Identity=23.778071334214, Blast_Score=119, Evalue=1e-26, Organism=Homo sapiens, GI91823271, Length=664, Percent_Identity=25.3012048192771, Blast_Score=119, Evalue=1e-26, Organism=Escherichia coli, GI1789230, Length=744, Percent_Identity=24.8655913978495, Blast_Score=152, Evalue=9e-38, Organism=Escherichia coli, GI1789246, Length=776, Percent_Identity=23.3247422680412, Blast_Score=133, Evalue=4e-32, Organism=Caenorhabditis elegans, GI17540638, Length=742, Percent_Identity=23.8544474393531, Blast_Score=135, Evalue=9e-32, Organism=Caenorhabditis elegans, GI32566215, Length=694, Percent_Identity=24.9279538904899, Blast_Score=89, Evalue=7e-18, Organism=Drosophila melanogaster, GI17737937, Length=659, Percent_Identity=22.3065250379363, Blast_Score=98, Evalue=2e-20, Organism=Drosophila melanogaster, GI24647195, Length=537, Percent_Identity=21.2290502793296, Blast_Score=77, Evalue=3e-14, Organism=Drosophila melanogaster, GI24647197, Length=537, Percent_Identity=21.2290502793296, Blast_Score=77, Evalue=4e-14,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR000674 - InterPro: IPR008274 - InterPro: IPR012780 [H]
Pfam domain/function: PF01315 Ald_Xan_dh_C; PF02738 Ald_Xan_dh_C2 [H]
EC number: =1.2.99.2 [H]
Molecular weight: Translated: 75079; Mature: 75079
Theoretical pI: Translated: 5.16; Mature: 5.16
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.4 %Cys (Translated Protein) 1.6 %Met (Translated Protein) 2.0 %Cys+Met (Translated Protein) 0.4 %Cys (Mature Protein) 1.6 %Met (Mature Protein) 2.0 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MIQEHLPLITGKGSYIDDINPKNVVYLHIIRSPIARGIIKSISKPESALLSLTWEDVKLY CCCCCCCEEECCCCCCCCCCCCCEEEEEEHHHHHHHHHHHHCCCCCHHEEEEEEEEEEEE MPVRLFPDLAKTAQVAKMPVLADGRVNFVGQPILAFVVEDRYRTEDVAEEVLIDYDELKP ECHHHHHHHHHHHHHHHCCEEECCCCCCCCCCHHEEHECCCCCHHHHHHHHHHCHHHCCC VVDPEESLNADPIHPGLKSNISIDQLLEGGNLSLKNKAEVVVSRKLKQQRVVSNPMEPKG CCCCHHHCCCCCCCCCCCCCCCHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHCCCCCCCC FICWWDNDILNVYVSTQAPFGVKNDLREILGISPEKIRVYSAPNVGGGFGNKSGGYPEYV EEEEECCCEEEEEEECCCCCCHHHHHHHHHCCCCCCEEEEECCCCCCCCCCCCCCCHHHH LAAIASLKLGRPVKWIETRSEMLVNTQSLGRGEVSDMRLYATKDGEILGIEGTIIANIGA HHHHHHHHCCCCHHHHHHHHHHHEEHHHCCCCCCCCEEEEEECCCCEEEECCEEEEECCC FDYGIGFIAPLFIARLSNGPYKMKFASIRAMGVFTNTPPMGFYRGAGRPEAALIHETLVE HHHHHHHHHHHHHHHHCCCCEEEEEEEEEEEEEEECCCCCCCCCCCCCCHHHHHHHHHHH DLAEELGVDSVEIRRRNLIGDNGYVTPLGVRIDPAGYNEVLNEAEKYYRKAKEVYKDKGV HHHHHHCCCCEEHHHHHCCCCCCEEEEEEEEECCCCHHHHHHHHHHHHHHHHHHHHHCCC SIVTFAEIVRTSPGEGARVKIENGKVHFYLGIGPHGQAYGSTFKRLASEVLGISEDKIEI EEEEEHHHHHCCCCCCCEEEEECCEEEEEEEECCCCCHHHHHHHHHHHHHHCCCCCEEEE TTGSSEIVKEGIGSFGSRAGTIGGSAVIAAATELLKKLNTNSLNESELVKYEGVEAEVFY ECCCHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHCCCCCCHHHHEEECCCCEEEEE KADDIFAPGAHVAVIDVDKETGFIRVLEYYAVDDVGRAMNKEEIEGQIIGSVLQGASQVI ECCCEECCCCEEEEEEECCCCCCEEHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHH IEAMRYDERGIPLCSSIADCGVPTALEAPLKVKTEYIEYPSQLLSRSRGVGEAGTTGALP HHHHHCCCCCCCHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHHCCCCCCCCCCCCHH AVFIAVEKVTKKKFDRTPVDPWILVSST HHHHHHHHHHHHHCCCCCCCCEEEEECC >Mature Secondary Structure MIQEHLPLITGKGSYIDDINPKNVVYLHIIRSPIARGIIKSISKPESALLSLTWEDVKLY CCCCCCCEEECCCCCCCCCCCCCEEEEEEHHHHHHHHHHHHCCCCCHHEEEEEEEEEEEE MPVRLFPDLAKTAQVAKMPVLADGRVNFVGQPILAFVVEDRYRTEDVAEEVLIDYDELKP ECHHHHHHHHHHHHHHHCCEEECCCCCCCCCCHHEEHECCCCCHHHHHHHHHHCHHHCCC VVDPEESLNADPIHPGLKSNISIDQLLEGGNLSLKNKAEVVVSRKLKQQRVVSNPMEPKG CCCCHHHCCCCCCCCCCCCCCCHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHCCCCCCCC FICWWDNDILNVYVSTQAPFGVKNDLREILGISPEKIRVYSAPNVGGGFGNKSGGYPEYV EEEEECCCEEEEEEECCCCCCHHHHHHHHHCCCCCCEEEEECCCCCCCCCCCCCCCHHHH LAAIASLKLGRPVKWIETRSEMLVNTQSLGRGEVSDMRLYATKDGEILGIEGTIIANIGA HHHHHHHHCCCCHHHHHHHHHHHEEHHHCCCCCCCCEEEEEECCCCEEEECCEEEEECCC FDYGIGFIAPLFIARLSNGPYKMKFASIRAMGVFTNTPPMGFYRGAGRPEAALIHETLVE HHHHHHHHHHHHHHHHCCCCEEEEEEEEEEEEEEECCCCCCCCCCCCCCHHHHHHHHHHH DLAEELGVDSVEIRRRNLIGDNGYVTPLGVRIDPAGYNEVLNEAEKYYRKAKEVYKDKGV HHHHHHCCCCEEHHHHHCCCCCCEEEEEEEEECCCCHHHHHHHHHHHHHHHHHHHHHCCC SIVTFAEIVRTSPGEGARVKIENGKVHFYLGIGPHGQAYGSTFKRLASEVLGISEDKIEI EEEEEHHHHHCCCCCCCEEEEECCEEEEEEEECCCCCHHHHHHHHHHHHHHCCCCCEEEE TTGSSEIVKEGIGSFGSRAGTIGGSAVIAAATELLKKLNTNSLNESELVKYEGVEAEVFY ECCCHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHCCCCCCHHHHEEECCCCEEEEE KADDIFAPGAHVAVIDVDKETGFIRVLEYYAVDDVGRAMNKEEIEGQIIGSVLQGASQVI ECCCEECCCCEEEEEEECCCCCCEEHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHH IEAMRYDERGIPLCSSIADCGVPTALEAPLKVKTEYIEYPSQLLSRSRGVGEAGTTGALP HHHHHCCCCCCCHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHHCCCCCCCCCCCCHH AVFIAVEKVTKKKFDRTPVDPWILVSST HHHHHHHHHHHHHCCCCCCCCEEEEECC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 10482497; 2818128; 10966817; 11076018 [H]