The gene/protein map for NC_007802 is currently unavailable.
Definition Jannaschia sp. CCS1 chromosome, complete genome.
Accession NC_007802
Length 4,317,977

Click here to switch to the map view.

The map label for this gene is cutL [H]

Identifier: 89053943

GI number: 89053943

Start: 1421389

End: 1423494

Strand: Direct

Name: cutL [H]

Synonym: Jann_1452

Alternate gene names: 89053943

Gene position: 1421389-1423494 (Clockwise)

Preceding gene: 89053941

Following gene: 89053944

Centisome position: 32.92

GC content: 68.8

Gene sequence:

>2106_bases
ATGCTGGACCGTTCGACCCATGTGATTGGTGCCTCTCCGGGGGATCGCCGCGCTGCCGTCAGGCTGCGGGGGCAGGGCTG
CTTTGCGGGCGATGTGGCCCTGCACGATCCTTTGCATCTGGCCTTTGCCCGCAGCGCCGTGCCGGAGGGGGATCTGGCCC
CGGTGGACATCGACGACGCGCTGGATCTGCCCGGTGTCCTAGCCGTTCACGCCGGTTGTGACGTGTCCGGCTTGGGCGCT
TTGTCGGTGAACCCCGTCCTGCCGCTGCCCGTGCCGCCCGCCTATCCGATCCTGGCCGGGGGCCGCGTGGAGTGGTTGGG
GCAGCCGATTGCCGGAATCCTCGCCGACACGCCCCAGGCCGCGTTGGACGGCGCGGAGGCGGTGTGGGCAGATGTCGCTG
AAACGGAGACGACGCCCCAGCCCCTTGCGACCAAAAGCTGGCGCACCGGTGATCCGGCGCAGGCCTTCGCCCAGGCCGCC
CATGTGGTGGAGGTGGCGGTCAACCACCCCCGTCTGGCCCCTTGTCCGTTGGAGCCGCGCGCGATTGCGGTGGACTGGGC
GGAGAAGGGGCTGACGATCTGGCTATCCACGCAGACGCCGCACCGGGCCCGGTCGGAGCTGGCGCAGATCCTGGGTGTCG
ATGCGGAGACGTTAAGGGTGATCGCGCCCGATGTGGGGGGCGCGTTCGGGATGAAGGGCTCCCTGTATCCGGAGGAGGTT
TTTGCCGTCTGGGCGGCCCTGCACCACCGCCGTTCTGTGCGTTGGTGCGCCACACGGGGCGAGGATTTCCTGTCGGCCAC
CCACGGGCGCGGGTTGAGCACGCGGGGGCGATTGGCGGTGGCGCGCGACGGCACATTCCTTGCGCTGGAGGCGCGGGTCG
ATGCACCTTTGGGGGCCTGGGTGCCGAATTCGGGCCTGGTGCCAGCCTGGAACGCGGCGCGGATCCTGCCGTGCGGCTAT
GATATTCCGACGGTGGACATCCAGACCTCTGCCACGCCCGGGCACCGCGCGCCCACGGGGATCTATCGCGGCGCTGGCCG
GCCCGAGGCCGCCTGCCTGATGGAGCGTCTGGCCGATGCGGCGGCGCGCGCCACAGGCGTTGATCCGCTGGAGATCCGGG
CACGCAATGTCCATGGATCGGGCACGCTGCCGGTGCGAACCGCGACGGGCAACCTGCTGGATTCCGGCGATTATCCTGCG
GCCTTGGCGGGGGCTGCGACGGCGGCCGATTATCGCGCATTGCAGGCAAAGCGGACGCGCAAACGCACGTTGGGCCATCT
GTCGGGCATCGGCGTGGCCTTCTATCTGGAGCCTTCGGGCGAGGGGTTCGAGACGGCGCGCGTGACCTGGACGGATGCAG
GCGTGGAGATCGCAAGCGGCTCCTCCAGCCAGGGACACGGGCGGGAGACGGCCTATGCCCAGATCGCCTCGGACGTGTTG
CAAATCGCGTCGGGCGATGTGGAGGTTTTGCAGGGCGACACGGCGACCTGCCCGGCGGGGATCGGGGCCGTTGCCTCACG
CGGGACGGCGATTGGCGGCAGTGCGGTGTTCGTGGCCTGTGAGCGCCTTCGCGCACGGCATCTGAGTGGAGAGCCCCTGC
CGCTGACCGAGGATATCCGGTATGAGAATGAAGGGCAGGCCTGGGGTTATGGCGTCACCCTGGTGGCCGCCGATGTGGAT
CGCGAGACGGGGGCCGTGGCGATCACCCATGTCACCTGTTTTGACGATGCGGGCCGTTTGGTGAACCCGGCCTTCGTGGA
GGGGCAGATCCGGGGCGGCTTTGCCCAAGGTCTGGGCGAGGCGATGATGGAGGCGGTGGTCTATGACGATGACGGGCAGT
TGCTGACCGGGAGCCTGATGGATTACGCCCTGCCACGCGCCACGGACATGCCCGGGATCTCGATCCACGGGTCCGAGCAT
CCCACATCGCTGAACGCGCTTGGGGTGAAGGGCGTGGGGGAGGCGGGCACTATCGGGGCCCCGCCTGCGATCCTGGGCGC
GGTTCTGGACGCGCTGGCCCCGCTGGGCGTAACGGATCTGGATATGCCGCTGACGCCTTGCAAGATTTGGTCCGCCATTC
AGGCGGCGGAGAGGGATGTTTCATGA

Upstream 100 bases:

>100_bases
GGACCACCCCTAGCAGTCCGCGCGCCTGTCGCCCAAAAGTTTCCCGATCCATGCCGGGATTTGGTTTTCGAATCCTCGGG
TTCATGGTTGATTTGCCGCG

Downstream 100 bases:

>100_bases
AATACAATCGCTTGGACGCCAAAGATCATGCCCGTGAGCATTTCAACGGGATCTGGGCGGCGTGCCTGAACCCTTGGCGA
CCCGACGGGGCGTTCGATGA

Product: molybdopterin binding aldehyde oxidase and xanthine dehydrogenase

Products: NA

Alternate protein names: CO dehydrogenase subunit L; CO-DH L [H]

Number of amino acids: Translated: 701; Mature: 701

Protein sequence:

>701_residues
MLDRSTHVIGASPGDRRAAVRLRGQGCFAGDVALHDPLHLAFARSAVPEGDLAPVDIDDALDLPGVLAVHAGCDVSGLGA
LSVNPVLPLPVPPAYPILAGGRVEWLGQPIAGILADTPQAALDGAEAVWADVAETETTPQPLATKSWRTGDPAQAFAQAA
HVVEVAVNHPRLAPCPLEPRAIAVDWAEKGLTIWLSTQTPHRARSELAQILGVDAETLRVIAPDVGGAFGMKGSLYPEEV
FAVWAALHHRRSVRWCATRGEDFLSATHGRGLSTRGRLAVARDGTFLALEARVDAPLGAWVPNSGLVPAWNAARILPCGY
DIPTVDIQTSATPGHRAPTGIYRGAGRPEAACLMERLADAAARATGVDPLEIRARNVHGSGTLPVRTATGNLLDSGDYPA
ALAGAATAADYRALQAKRTRKRTLGHLSGIGVAFYLEPSGEGFETARVTWTDAGVEIASGSSSQGHGRETAYAQIASDVL
QIASGDVEVLQGDTATCPAGIGAVASRGTAIGGSAVFVACERLRARHLSGEPLPLTEDIRYENEGQAWGYGVTLVAADVD
RETGAVAITHVTCFDDAGRLVNPAFVEGQIRGGFAQGLGEAMMEAVVYDDDGQLLTGSLMDYALPRATDMPGISIHGSEH
PTSLNALGVKGVGEAGTIGAPPAILGAVLDALAPLGVTDLDMPLTPCKIWSAIQAAERDVS

Sequences:

>Translated_701_residues
MLDRSTHVIGASPGDRRAAVRLRGQGCFAGDVALHDPLHLAFARSAVPEGDLAPVDIDDALDLPGVLAVHAGCDVSGLGA
LSVNPVLPLPVPPAYPILAGGRVEWLGQPIAGILADTPQAALDGAEAVWADVAETETTPQPLATKSWRTGDPAQAFAQAA
HVVEVAVNHPRLAPCPLEPRAIAVDWAEKGLTIWLSTQTPHRARSELAQILGVDAETLRVIAPDVGGAFGMKGSLYPEEV
FAVWAALHHRRSVRWCATRGEDFLSATHGRGLSTRGRLAVARDGTFLALEARVDAPLGAWVPNSGLVPAWNAARILPCGY
DIPTVDIQTSATPGHRAPTGIYRGAGRPEAACLMERLADAAARATGVDPLEIRARNVHGSGTLPVRTATGNLLDSGDYPA
ALAGAATAADYRALQAKRTRKRTLGHLSGIGVAFYLEPSGEGFETARVTWTDAGVEIASGSSSQGHGRETAYAQIASDVL
QIASGDVEVLQGDTATCPAGIGAVASRGTAIGGSAVFVACERLRARHLSGEPLPLTEDIRYENEGQAWGYGVTLVAADVD
RETGAVAITHVTCFDDAGRLVNPAFVEGQIRGGFAQGLGEAMMEAVVYDDDGQLLTGSLMDYALPRATDMPGISIHGSEH
PTSLNALGVKGVGEAGTIGAPPAILGAVLDALAPLGVTDLDMPLTPCKIWSAIQAAERDVS
>Mature_701_residues
MLDRSTHVIGASPGDRRAAVRLRGQGCFAGDVALHDPLHLAFARSAVPEGDLAPVDIDDALDLPGVLAVHAGCDVSGLGA
LSVNPVLPLPVPPAYPILAGGRVEWLGQPIAGILADTPQAALDGAEAVWADVAETETTPQPLATKSWRTGDPAQAFAQAA
HVVEVAVNHPRLAPCPLEPRAIAVDWAEKGLTIWLSTQTPHRARSELAQILGVDAETLRVIAPDVGGAFGMKGSLYPEEV
FAVWAALHHRRSVRWCATRGEDFLSATHGRGLSTRGRLAVARDGTFLALEARVDAPLGAWVPNSGLVPAWNAARILPCGY
DIPTVDIQTSATPGHRAPTGIYRGAGRPEAACLMERLADAAARATGVDPLEIRARNVHGSGTLPVRTATGNLLDSGDYPA
ALAGAATAADYRALQAKRTRKRTLGHLSGIGVAFYLEPSGEGFETARVTWTDAGVEIASGSSSQGHGRETAYAQIASDVL
QIASGDVEVLQGDTATCPAGIGAVASRGTAIGGSAVFVACERLRARHLSGEPLPLTEDIRYENEGQAWGYGVTLVAADVD
RETGAVAITHVTCFDDAGRLVNPAFVEGQIRGGFAQGLGEAMMEAVVYDDDGQLLTGSLMDYALPRATDMPGISIHGSEH
PTSLNALGVKGVGEAGTIGAPPAILGAVLDALAPLGVTDLDMPLTPCKIWSAIQAAERDVS

Specific function: Catalyzes the oxidation of carbon monoxide to carbon dioxide [H]

COG id: COG1529

COG function: function code C; Aerobic-type carbon monoxide dehydrogenase, large subunit CoxL/CutL homologs

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

Organism=Homo sapiens, GI91823271, Length=749, Percent_Identity=23.3644859813084, Blast_Score=130, Evalue=4e-30,
Organism=Homo sapiens, GI71773480, Length=745, Percent_Identity=23.8926174496644, Blast_Score=126, Evalue=6e-29,
Organism=Escherichia coli, GI1789246, Length=600, Percent_Identity=28.5, Blast_Score=174, Evalue=2e-44,
Organism=Escherichia coli, GI1789230, Length=759, Percent_Identity=25.6916996047431, Blast_Score=162, Evalue=5e-41,
Organism=Escherichia coli, GI1786478, Length=709, Percent_Identity=26.0930888575458, Blast_Score=112, Evalue=6e-26,
Organism=Caenorhabditis elegans, GI17540638, Length=719, Percent_Identity=24.6175243393602, Blast_Score=130, Evalue=3e-30,
Organism=Caenorhabditis elegans, GI17539860, Length=702, Percent_Identity=20.7977207977208, Blast_Score=108, Evalue=1e-23,
Organism=Drosophila melanogaster, GI17737937, Length=707, Percent_Identity=24.3281471004243, Blast_Score=117, Evalue=3e-26,
Organism=Drosophila melanogaster, GI24647199, Length=701, Percent_Identity=23.5378031383738, Blast_Score=108, Evalue=1e-23,
Organism=Drosophila melanogaster, GI24647201, Length=731, Percent_Identity=23.2558139534884, Blast_Score=99, Evalue=7e-21,
Organism=Drosophila melanogaster, GI24647195, Length=670, Percent_Identity=23.8805970149254, Blast_Score=97, Evalue=4e-20,
Organism=Drosophila melanogaster, GI24647197, Length=670, Percent_Identity=23.8805970149254, Blast_Score=96, Evalue=8e-20,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR000674
- InterPro:   IPR008274
- InterPro:   IPR012780 [H]

Pfam domain/function: PF01315 Ald_Xan_dh_C; PF02738 Ald_Xan_dh_C2 [H]

EC number: =1.2.99.2 [H]

Molecular weight: Translated: 72784; Mature: 72784

Theoretical pI: Translated: 4.93; Mature: 4.93

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.4 %Cys     (Translated Protein)
1.1 %Met     (Translated Protein)
2.6 %Cys+Met (Translated Protein)
1.4 %Cys     (Mature Protein)
1.1 %Met     (Mature Protein)
2.6 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MLDRSTHVIGASPGDRRAAVRLRGQGCFAGDVALHDPLHLAFARSAVPEGDLAPVDIDDA
CCCCCCEEEECCCCCCEEEEEEECCCCEECCCEECCCHHHHHHHHCCCCCCCCCCCCHHC
LDLPGVLAVHAGCDVSGLGALSVNPVLPLPVPPAYPILAGGRVEWLGQPIAGILADTPQA
CCCCCEEEEECCCCCCCCCCEECCCCCCCCCCCCCCEEECCCHHCCCCCHHHHHCCCCHH
ALDGAEAVWADVAETETTPQPLATKSWRTGDPAQAFAQAAHVVEVAVNHPRLAPCPLEPR
HHCCHHHHHHHHHHCCCCCCCCCCCCCCCCCHHHHHHHHHHHEEEEECCCCCCCCCCCCC
AIAVDWAEKGLTIWLSTQTPHRARSELAQILGVDAETLRVIAPDVGGAFGMKGSLYPEEV
EEEEEECCCCEEEEEECCCCHHHHHHHHHHHCCCHHHEEEECCCCCCCCCCCCCCCHHHH
FAVWAALHHRRSVRWCATRGEDFLSATHGRGLSTRGRLAVARDGTFLALEARVDAPLGAW
HHHHHHHHHCCCEEEECCCCCHHHHHHCCCCCCCCCCEEEEECCEEEEEEEECCCCCCCC
VPNSGLVPAWNAARILPCGYDIPTVDIQTSATPGHRAPTGIYRGAGRPEAACLMERLADA
CCCCCCCCCCCCCEEEECCCCCCEEEEECCCCCCCCCCCCHHCCCCCCHHHHHHHHHHHH
AARATGVDPLEIRARNVHGSGTLPVRTATGNLLDSGDYPAALAGAATAADYRALQAKRTR
HHHHCCCCCCEEEEEECCCCCCEEEEECCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHH
KRTLGHLSGIGVAFYLEPSGEGFETARVTWTDAGVEIASGSSSQGHGRETAYAQIASDVL
HHHHHHHCCCCEEEEECCCCCCCEEEEEEEECCCEEEECCCCCCCCCCHHHHHHHHHHHH
QIASGDVEVLQGDTATCPAGIGAVASRGTAIGGSAVFVACERLRARHLSGEPLPLTEDIR
HHHCCCEEEEECCCCCCCCCCHHHHCCCCCCCCHHHHHHHHHHHHHCCCCCCCCCCCCCC
YENEGQAWGYGVTLVAADVDRETGAVAITHVTCFDDAGRLVNPAFVEGQIRGGFAQGLGE
CCCCCCEEECEEEEEEEECCCCCCCEEEEEEEEECCCCCCCCCCEEECEECCCHHHHHHH
AMMEAVVYDDDGQLLTGSLMDYALPRATDMPGISIHGSEHPTSLNALGVKGVGEAGTIGA
HHHHHEEECCCCCEEECHHHHHHCCCCCCCCCEEEECCCCCCCCEEECCCCCCCCCCCCC
PPAILGAVLDALAPLGVTDLDMPLTPCKIWSAIQAAERDVS
CHHHHHHHHHHHHCCCCCCCCCCCCHHHHHHHHHHHHHCCC
>Mature Secondary Structure
MLDRSTHVIGASPGDRRAAVRLRGQGCFAGDVALHDPLHLAFARSAVPEGDLAPVDIDDA
CCCCCCEEEECCCCCCEEEEEEECCCCEECCCEECCCHHHHHHHHCCCCCCCCCCCCHHC
LDLPGVLAVHAGCDVSGLGALSVNPVLPLPVPPAYPILAGGRVEWLGQPIAGILADTPQA
CCCCCEEEEECCCCCCCCCCEECCCCCCCCCCCCCCEEECCCHHCCCCCHHHHHCCCCHH
ALDGAEAVWADVAETETTPQPLATKSWRTGDPAQAFAQAAHVVEVAVNHPRLAPCPLEPR
HHCCHHHHHHHHHHCCCCCCCCCCCCCCCCCHHHHHHHHHHHEEEEECCCCCCCCCCCCC
AIAVDWAEKGLTIWLSTQTPHRARSELAQILGVDAETLRVIAPDVGGAFGMKGSLYPEEV
EEEEEECCCCEEEEEECCCCHHHHHHHHHHHCCCHHHEEEECCCCCCCCCCCCCCCHHHH
FAVWAALHHRRSVRWCATRGEDFLSATHGRGLSTRGRLAVARDGTFLALEARVDAPLGAW
HHHHHHHHHCCCEEEECCCCCHHHHHHCCCCCCCCCCEEEEECCEEEEEEEECCCCCCCC
VPNSGLVPAWNAARILPCGYDIPTVDIQTSATPGHRAPTGIYRGAGRPEAACLMERLADA
CCCCCCCCCCCCCEEEECCCCCCEEEEECCCCCCCCCCCCHHCCCCCCHHHHHHHHHHHH
AARATGVDPLEIRARNVHGSGTLPVRTATGNLLDSGDYPAALAGAATAADYRALQAKRTR
HHHHCCCCCCEEEEEECCCCCCEEEEECCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHH
KRTLGHLSGIGVAFYLEPSGEGFETARVTWTDAGVEIASGSSSQGHGRETAYAQIASDVL
HHHHHHHCCCCEEEEECCCCCCCEEEEEEEECCCEEEECCCCCCCCCCHHHHHHHHHHHH
QIASGDVEVLQGDTATCPAGIGAVASRGTAIGGSAVFVACERLRARHLSGEPLPLTEDIR
HHHCCCEEEEECCCCCCCCCCHHHHCCCCCCCCHHHHHHHHHHHHHCCCCCCCCCCCCCC
YENEGQAWGYGVTLVAADVDRETGAVAITHVTCFDDAGRLVNPAFVEGQIRGGFAQGLGE
CCCCCCEEECEEEEEEEECCCCCCCEEEEEEEEECCCCCCCCCCEEECEECCCHHHHHHH
AMMEAVVYDDDGQLLTGSLMDYALPRATDMPGISIHGSEHPTSLNALGVKGVGEAGTIGA
HHHHHEEECCCCCEEECHHHHHHCCCCCCCCCEEEECCCCCCCCEEECCCCCCCCCCCCC
PPAILGAVLDALAPLGVTDLDMPLTPCKIWSAIQAAERDVS
CHHHHHHHHHHHHCCCCCCCCCCCCHHHHHHHHHHHHHCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 10482497; 2818128; 10966817; 11076018 [H]