| Definition | Mesorhizobium loti MAFF303099 chromosome, complete genome. |
|---|---|
| Accession | NC_002678 |
| Length | 7,036,071 |
Click here to switch to the map view.
The map label for this gene is cutL [H]
Identifier: 13471217
GI number: 13471217
Start: 943634
End: 945982
Strand: Reverse
Name: cutL [H]
Synonym: mll1128
Alternate gene names: 13471217
Gene position: 945982-943634 (Counterclockwise)
Preceding gene: 13471218
Following gene: 13471216
Centisome position: 13.44
GC content: 63.9
Gene sequence:
>2349_bases ATGGGCATTGAAGGTGTTGGCGCTCGGGTCGCGCGCAAGGAAGACAAAAGATTCATCACCGGCGCCGGCCGCTATGTCGA CGACATGGTGGTTCCCGGCATGAAGCATGCCGCCTTCGTGCGCAGCCCGCACGCGCATGCGCAGATCAAGAAGATCGACG TCAGACGAGCACAAGCGATGCCCGGCGTCATCGGCGTGCTGACCGGCAAGGAGCTCAAGGCCGACGGCATCGGCAATTTG ATCTGCGGCTGGATGATCCATTCCAAGGACGGTTCGCCGATGAAGATGGGCGCCTGGTCGCCGCTGGCTGTCGACAAGGT CCGCTATGTCGGTGACGCCGTCGTCGTCGTCGTGGCCGAGACCAAGGGGCAGGCCCGCGATGCGGCCGAGGCGGTCGAGA TCACATACAAGGAATTGAAGGCCGTCGTCGAAGCCACCAAGGCGCTCGAAAAGGGCGCGCCGCAGATCCATGCCGAGGCC GAGAACAATCTGATCTTCGATTGGGAGATCGGCGACGCCAAGGCGACCGACGCGGCGATCAAGGCAGCGGCGCATGTCAC CCGCATGAAGATCGTCAACAACCGGCTGGTGCCGAATGCCATGGAGCCGCGCGCGGCTCTCGGCCACTACGACAAGGCCG AGGACCATTATACCTGCTGGACGACCTCGCAGAACCCGCATGTCGCGCGGCTGGTGATGAGCGCCTTCTACAATGTCGCG CCGGAAAACAAGCTGCGCGTCATCGCGCCTGACGTCGGCGGCGGCTTCGGCTCCAAGATCTACATCTATCCCGAAGAGAT CGTCTGCCTGTGGGCTTCCAAGAAAACCGGCGTGCCGGTCAAATGGGTCGCCGACCGCACCGAGAGTTTTCTCTCCGACG CGCATGGCCGCGACCATGTCTCGACGGTGGAAATGGCTTTCGACAAGAACAACAGGATCACCGGGCTGAAGGTCGACACG ATCGCCAATCTCGGCGCCTACATGTCGCTGTTCTCGTCCTGCGTGCCGACCTATCTCTACGCGACATTGTTGTCGGGCCA GTACGACATTCCGGCCATCCACGCCAATGTGCGCACGGTCTACACCAACACAGCTCCTGTCGATGCCTATCGCGGGGCAG GGCGGCCGGAAGCCACCTATCTCCTGGAACGCACGATGGAAGCGGCGGCGCGCGAGCTTGGCGTGTCACCTGCCGAATTG CGGCGCAAGAACTTCATCACCTCCTTCCCGCACCAGACACCGGTGATCATGAACTATGACGCCGGTGACTATGGCGCCTC GCTCGATGCGGCCATGAAAGCTTCGGACTATGCCGGCTTTGCCAAGCGCAAGGCGGCGGCCGCCAAGAAGGGCTTGCTCC GCGGCATCGGCATGAGCTGTTACATCGAGGCCTGCGGCATCGCGCCGTCGGCGGCGGTCGGTTCGCTCGGCGCCGGCGTT GGCCTCTGGGAATCGGCCGAAGTGCGGGTCAATGCCGTTGGCACGATCGAGGTGCTGACCGGCTCGCACAGCCATGGCCA GGGCCACGAGACGACCTTCGCGCAACTGGTCAACCAGCGTTTTGGCGTGCCGATCGATTCGGTTTCGATCGTCCATGGCG ACACCGACAAGGTGCAGATGGGCATGGGCACGTACGGTTCGCGCTCGGGCGCGGTCGGCATGTCGGCGATATCAAAGGCA CTCGACAAGGTCGAGGCCAAGGCCAAGAAGATCGCCGCCCACCTGCTCGAGGCCGACGAGGGCGACATCGTCATCGAGAA CGGCGCGCTGAAGGTCGCCGGTACCGACAAGAACGTGCCGTGGTTCCAGGTGGCGCTGGCCGCCTATACCGCCCACAATC TGCCGGCAGGGATGGAGCCCGGATTGAAGGAAACGGCCTTCTACGATCCGTCGAACTTCACCTTTCCGGCGGGCTGCTAC ATCTGCGAGGTCGAGATCGAGCCGGAGACCGGAACGACCGAGATCGTCCAGTTCGTGGCCGCCGACGATTTCGGCAACAT CATCAATCCGATGATCGTGGAAGGCCAGGTGCATGGCGGCATCGCGCAAGGGATCGGCCAGGCGCTGCTGGAAGGCGCCC ATTACGACGCCAGCGGACAGCTGCTGACCGCGAGCTACATGGACTATACGATGCCGCGCGCGGGCGACCTGCCGTCGTTC AAGGTCTCAACCTCGAACACGCCATGCCCGGGCAATCCGCTCGGCATCAAGGGCTGCGGCGAGGCCGGCGCCATCGGCTC GCCGCCGGCGGTGATCAACGCCATCACCGATGCCATCGGCATCGCCGATATCGCCATGCCCGCCTCGCCGCCCACCGTGT GGGCCGCGATCCGCGCCGCGAAGCATTGA
Upstream 100 bases:
>100_bases GCAGTAAGGCAGTAGGGCAGTAGGGAACCGGAACCAGTTTTCCCGTACTGCCGTACTGCCCTACTCACCTACTCCCCTAC AATCTCGGGAGGAATTTCTT
Downstream 100 bases:
>100_bases GGAGGAACAACCATGTATTCGGTCAACTACCACCGTGCCGCCTCGGTCGCGGATGCCGCCAAGCTGGTGAAGAACGGCGA CGCCAAGCTGCTGTCCGGCG
Product: carbon-monoxide dehydrogenase large subunit
Products: NA
Alternate protein names: CO dehydrogenase subunit L; CO-DH L [H]
Number of amino acids: Translated: 782; Mature: 781
Protein sequence:
>782_residues MGIEGVGARVARKEDKRFITGAGRYVDDMVVPGMKHAAFVRSPHAHAQIKKIDVRRAQAMPGVIGVLTGKELKADGIGNL ICGWMIHSKDGSPMKMGAWSPLAVDKVRYVGDAVVVVVAETKGQARDAAEAVEITYKELKAVVEATKALEKGAPQIHAEA ENNLIFDWEIGDAKATDAAIKAAAHVTRMKIVNNRLVPNAMEPRAALGHYDKAEDHYTCWTTSQNPHVARLVMSAFYNVA PENKLRVIAPDVGGGFGSKIYIYPEEIVCLWASKKTGVPVKWVADRTESFLSDAHGRDHVSTVEMAFDKNNRITGLKVDT IANLGAYMSLFSSCVPTYLYATLLSGQYDIPAIHANVRTVYTNTAPVDAYRGAGRPEATYLLERTMEAAARELGVSPAEL RRKNFITSFPHQTPVIMNYDAGDYGASLDAAMKASDYAGFAKRKAAAAKKGLLRGIGMSCYIEACGIAPSAAVGSLGAGV GLWESAEVRVNAVGTIEVLTGSHSHGQGHETTFAQLVNQRFGVPIDSVSIVHGDTDKVQMGMGTYGSRSGAVGMSAISKA LDKVEAKAKKIAAHLLEADEGDIVIENGALKVAGTDKNVPWFQVALAAYTAHNLPAGMEPGLKETAFYDPSNFTFPAGCY ICEVEIEPETGTTEIVQFVAADDFGNIINPMIVEGQVHGGIAQGIGQALLEGAHYDASGQLLTASYMDYTMPRAGDLPSF KVSTSNTPCPGNPLGIKGCGEAGAIGSPPAVINAITDAIGIADIAMPASPPTVWAAIRAAKH
Sequences:
>Translated_782_residues MGIEGVGARVARKEDKRFITGAGRYVDDMVVPGMKHAAFVRSPHAHAQIKKIDVRRAQAMPGVIGVLTGKELKADGIGNL ICGWMIHSKDGSPMKMGAWSPLAVDKVRYVGDAVVVVVAETKGQARDAAEAVEITYKELKAVVEATKALEKGAPQIHAEA ENNLIFDWEIGDAKATDAAIKAAAHVTRMKIVNNRLVPNAMEPRAALGHYDKAEDHYTCWTTSQNPHVARLVMSAFYNVA PENKLRVIAPDVGGGFGSKIYIYPEEIVCLWASKKTGVPVKWVADRTESFLSDAHGRDHVSTVEMAFDKNNRITGLKVDT IANLGAYMSLFSSCVPTYLYATLLSGQYDIPAIHANVRTVYTNTAPVDAYRGAGRPEATYLLERTMEAAARELGVSPAEL RRKNFITSFPHQTPVIMNYDAGDYGASLDAAMKASDYAGFAKRKAAAAKKGLLRGIGMSCYIEACGIAPSAAVGSLGAGV GLWESAEVRVNAVGTIEVLTGSHSHGQGHETTFAQLVNQRFGVPIDSVSIVHGDTDKVQMGMGTYGSRSGAVGMSAISKA LDKVEAKAKKIAAHLLEADEGDIVIENGALKVAGTDKNVPWFQVALAAYTAHNLPAGMEPGLKETAFYDPSNFTFPAGCY ICEVEIEPETGTTEIVQFVAADDFGNIINPMIVEGQVHGGIAQGIGQALLEGAHYDASGQLLTASYMDYTMPRAGDLPSF KVSTSNTPCPGNPLGIKGCGEAGAIGSPPAVINAITDAIGIADIAMPASPPTVWAAIRAAKH >Mature_781_residues GIEGVGARVARKEDKRFITGAGRYVDDMVVPGMKHAAFVRSPHAHAQIKKIDVRRAQAMPGVIGVLTGKELKADGIGNLI CGWMIHSKDGSPMKMGAWSPLAVDKVRYVGDAVVVVVAETKGQARDAAEAVEITYKELKAVVEATKALEKGAPQIHAEAE NNLIFDWEIGDAKATDAAIKAAAHVTRMKIVNNRLVPNAMEPRAALGHYDKAEDHYTCWTTSQNPHVARLVMSAFYNVAP ENKLRVIAPDVGGGFGSKIYIYPEEIVCLWASKKTGVPVKWVADRTESFLSDAHGRDHVSTVEMAFDKNNRITGLKVDTI ANLGAYMSLFSSCVPTYLYATLLSGQYDIPAIHANVRTVYTNTAPVDAYRGAGRPEATYLLERTMEAAARELGVSPAELR RKNFITSFPHQTPVIMNYDAGDYGASLDAAMKASDYAGFAKRKAAAAKKGLLRGIGMSCYIEACGIAPSAAVGSLGAGVG LWESAEVRVNAVGTIEVLTGSHSHGQGHETTFAQLVNQRFGVPIDSVSIVHGDTDKVQMGMGTYGSRSGAVGMSAISKAL DKVEAKAKKIAAHLLEADEGDIVIENGALKVAGTDKNVPWFQVALAAYTAHNLPAGMEPGLKETAFYDPSNFTFPAGCYI CEVEIEPETGTTEIVQFVAADDFGNIINPMIVEGQVHGGIAQGIGQALLEGAHYDASGQLLTASYMDYTMPRAGDLPSFK VSTSNTPCPGNPLGIKGCGEAGAIGSPPAVINAITDAIGIADIAMPASPPTVWAAIRAAKH
Specific function: Catalyzes the oxidation of carbon monoxide to carbon dioxide [H]
COG id: COG1529
COG function: function code C; Aerobic-type carbon monoxide dehydrogenase, large subunit CoxL/CutL homologs
Gene ontology:
Cell location: Cytoplasmic
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: NA
Homologues:
Organism=Homo sapiens, GI91823271, Length=761, Percent_Identity=24.5729303547963, Blast_Score=147, Evalue=5e-35, Organism=Homo sapiens, GI71773480, Length=762, Percent_Identity=25.4593175853018, Blast_Score=141, Evalue=2e-33, Organism=Escherichia coli, GI1789230, Length=783, Percent_Identity=28.6079182630907, Blast_Score=248, Evalue=1e-66, Organism=Escherichia coli, GI1789246, Length=818, Percent_Identity=26.039119804401, Blast_Score=208, Evalue=1e-54, Organism=Escherichia coli, GI1786478, Length=762, Percent_Identity=24.8031496062992, Blast_Score=105, Evalue=2e-23, Organism=Caenorhabditis elegans, GI17539860, Length=797, Percent_Identity=24.9686323713927, Blast_Score=139, Evalue=6e-33, Organism=Caenorhabditis elegans, GI17540638, Length=792, Percent_Identity=23.8636363636364, Blast_Score=128, Evalue=1e-29, Organism=Caenorhabditis elegans, GI32566215, Length=536, Percent_Identity=23.6940298507463, Blast_Score=96, Evalue=9e-20, Organism=Drosophila melanogaster, GI17737937, Length=801, Percent_Identity=25.7178526841448, Blast_Score=120, Evalue=4e-27,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR000674 - InterPro: IPR008274 - InterPro: IPR012780 [H]
Pfam domain/function: PF01315 Ald_Xan_dh_C; PF02738 Ald_Xan_dh_C2 [H]
EC number: =1.2.99.2 [H]
Molecular weight: Translated: 82983; Mature: 82852
Theoretical pI: Translated: 6.66; Mature: 6.66
Prosite motif: PS00107 PROTEIN_KINASE_ATP
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.3 %Cys (Translated Protein) 3.1 %Met (Translated Protein) 4.3 %Cys+Met (Translated Protein) 1.3 %Cys (Mature Protein) 2.9 %Met (Mature Protein) 4.2 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MGIEGVGARVARKEDKRFITGAGRYVDDMVVPGMKHAAFVRSPHAHAQIKKIDVRRAQAM CCCCCCCHHHHHHCCCEEEEECCCHHHHHHCCCCHHHHHHCCCCCHHEEHHHHHHHHHCC PGVIGVLTGKELKADGIGNLICGWMIHSKDGSPMKMGAWSPLAVDKVRYVGDAVVVVVAE CCEEEEECCCCCCCCCCCCEEEEEEEECCCCCCEEECCCCCHHHHHHHHCCCEEEEEEEC TKGQARDAAEAVEITYKELKAVVEATKALEKGAPQIHAEAENNLIFDWEIGDAKATDAAI CCCCCHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEEECCCCEEEEEECCCCCHHHHHH KAAAHVTRMKIVNNRLVPNAMEPRAALGHYDKAEDHYTCWTTSQNPHVARLVMSAFYNVA HHHHHHHHHHHHHCCCCCCCCCCHHHHCCCCCCCCCEEEEECCCCCHHHHHHHHHHHHCC PENKLRVIAPDVGGGFGSKIYIYPEEIVCLWASKKTGVPVKWVADRTESFLSDAHGRDHV CCCCEEEEECCCCCCCCCEEEEECCEEEEEEECCCCCCCEEEHHHHHHHHHHHCCCCCCC STVEMAFDKNNRITGLKVDTIANLGAYMSLFSSCVPTYLYATLLSGQYDIPAIHANVRTV EEEEEEECCCCCEEEEEHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCEEECCEEEE YTNTAPVDAYRGAGRPEATYLLERTMEAAARELGVSPAELRRKNFITSFPHQTPVIMNYD EECCCCCHHHCCCCCCHHHHHHHHHHHHHHHHHCCCHHHHHHHHCCCCCCCCCCEEEECC AGDYGASLDAAMKASDYAGFAKRKAAAAKKGLLRGIGMSCYIEACGIAPSAAVGSLGAGV CCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCEEEEEECCCCCCHHHHCCCCCC GLWESAEVRVNAVGTIEVLTGSHSHGQGHETTFAQLVNQRFGVPIDSVSIVHGDTDKVQM CCCCCCCEEEEEEEEEEEEECCCCCCCCCHHHHHHHHHHHCCCCCCCEEEEECCCCEEEE GMGTYGSRSGAVGMSAISKALDKVEAKAKKIAAHLLEADEGDIVIENGALKVAGTDKNVP CCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCEEEECCEEEEECCCCCCC WFQVALAAYTAHNLPAGMEPGLKETAFYDPSNFTFPAGCYICEVEIEPETGTTEIVQFVA HHHHHHHHHHHCCCCCCCCCCCCCCEEECCCCCCCCCCEEEEEEEECCCCCHHHHHHHHH ADDFGNIINPMIVEGQVHGGIAQGIGQALLEGAHYDASGQLLTASYMDYTMPRAGDLPSF HCCCCCCCCCEEEECCCCCHHHHHHHHHHHCCCCCCCCCCEEEEEHHHCCCCCCCCCCCE KVSTSNTPCPGNPLGIKGCGEAGAIGSPPAVINAITDAIGIADIAMPASPPTVWAAIRAA EEECCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHC KH CC >Mature Secondary Structure GIEGVGARVARKEDKRFITGAGRYVDDMVVPGMKHAAFVRSPHAHAQIKKIDVRRAQAM CCCCCCHHHHHHCCCEEEEECCCHHHHHHCCCCHHHHHHCCCCCHHEEHHHHHHHHHCC PGVIGVLTGKELKADGIGNLICGWMIHSKDGSPMKMGAWSPLAVDKVRYVGDAVVVVVAE CCEEEEECCCCCCCCCCCCEEEEEEEECCCCCCEEECCCCCHHHHHHHHCCCEEEEEEEC TKGQARDAAEAVEITYKELKAVVEATKALEKGAPQIHAEAENNLIFDWEIGDAKATDAAI CCCCCHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEEECCCCEEEEEECCCCCHHHHHH KAAAHVTRMKIVNNRLVPNAMEPRAALGHYDKAEDHYTCWTTSQNPHVARLVMSAFYNVA HHHHHHHHHHHHHCCCCCCCCCCHHHHCCCCCCCCCEEEEECCCCCHHHHHHHHHHHHCC PENKLRVIAPDVGGGFGSKIYIYPEEIVCLWASKKTGVPVKWVADRTESFLSDAHGRDHV CCCCEEEEECCCCCCCCCEEEEECCEEEEEEECCCCCCCEEEHHHHHHHHHHHCCCCCCC STVEMAFDKNNRITGLKVDTIANLGAYMSLFSSCVPTYLYATLLSGQYDIPAIHANVRTV EEEEEEECCCCCEEEEEHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCEEECCEEEE YTNTAPVDAYRGAGRPEATYLLERTMEAAARELGVSPAELRRKNFITSFPHQTPVIMNYD EECCCCCHHHCCCCCCHHHHHHHHHHHHHHHHHCCCHHHHHHHHCCCCCCCCCCEEEECC AGDYGASLDAAMKASDYAGFAKRKAAAAKKGLLRGIGMSCYIEACGIAPSAAVGSLGAGV CCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCEEEEEECCCCCCHHHHCCCCCC GLWESAEVRVNAVGTIEVLTGSHSHGQGHETTFAQLVNQRFGVPIDSVSIVHGDTDKVQM CCCCCCCEEEEEEEEEEEEECCCCCCCCCHHHHHHHHHHHCCCCCCCEEEEECCCCEEEE GMGTYGSRSGAVGMSAISKALDKVEAKAKKIAAHLLEADEGDIVIENGALKVAGTDKNVP CCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCEEEECCEEEEECCCCCCC WFQVALAAYTAHNLPAGMEPGLKETAFYDPSNFTFPAGCYICEVEIEPETGTTEIVQFVA HHHHHHHHHHHCCCCCCCCCCCCCCEEECCCCCCCCCCEEEEEEEECCCCCHHHHHHHHH ADDFGNIINPMIVEGQVHGGIAQGIGQALLEGAHYDASGQLLTASYMDYTMPRAGDLPSF HCCCCCCCCCEEEECCCCCHHHHHHHHHHHCCCCCCCCCCEEEEEHHHCCCCCCCCCCCE KVSTSNTPCPGNPLGIKGCGEAGAIGSPPAVINAITDAIGIADIAMPASPPTVWAAIRAA EEECCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHC KH CC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 10482497; 2818128; 10966817; 11076018 [H]