Definition Geobacter sulfurreducens PCA chromosome, complete genome.
Accession NC_002939
Length 3,814,139

Click here to switch to the map view.

The map label for this gene is cooS [H]

Identifier: 39997196

GI number: 39997196

Start: 2305590

End: 2307512

Strand: Reverse

Name: cooS [H]

Synonym: GSU2098

Alternate gene names: 39997196

Gene position: 2307512-2305590 (Counterclockwise)

Preceding gene: 39997197

Following gene: 39997195

Centisome position: 60.5

GC content: 67.5

Gene sequence:

>1923_bases
ATGGACCAGGCACGCAACGGTCATGACAGCCGCAGTATCGATCCGGCCGCGAAGGAGATGCTGCGTATCGCCGACCGCGA
AGGATACGCAACCATCTGGGAGCGTTACGAACAGCAGCAGCCCCAATGCAGCTACGGCCAGCTCGGCACCTGCTGCCGGA
TCTGCTCCATGGGACCGTGCCGGATCGACCCCTTCGGCGACGGCCCCACCCGCGGGGTCTGCGGGGCCACCGCCGATACG
ATGGTGGCGCGCAACTTGGCCCGGATGGCCGCGGTTGGTTCCTCCTCCCACTCCGATCACGGCCGGAAGGTGGCGCTGCT
CCTCAAGGCGGTGGCCAACGGCAGCAACACCGACTACCACATTGCCGACCCGGACAAGCTCACGGCGGTTGCGGAGCGCC
TGGGCATCCCCACGGCCGGCCGGTCGACCGCCGAGATAGCCGGCGACGTGGCAGCGGTGGCCATCGACTGTTTCGGCAAC
CAGGGGGAAGAGCCCATCGTCTTCATGGAGAAGTACATGCCCAAGAAGCGGTTCCAGCGCCTGCGGGAGCTGGAGGAGAC
CCTCTACCGCACCACGGGCGCGAAGACCGGGCTCCTGCCGCGGGCCATCGACCGGGAGGCCGTTGACATCCTGCACCGCA
CCCACTTCGGCTGCGACCACGATCCCCTTTCCCTGGTGGCCCAATCTGTCCGCTGCTCCCTTTCCGACGGCTGGGGGGGC
TCCCTGATCGCCACCGAGCTGCAGGACATCCTGCTCGGCTCGCCCATCATCAGGCCGGTGAAGGCCAATCTCGGCGTGCT
GGAGGCGGAGAGCGTCAACGTGGTGGTCCACGGCCACGAGCCCATCCTGTCGGCCAAGGTGGTGGAGATGGCCCAGTCCC
CCGAATGTCGCGCCGCGGCCGAGGCCGTGGGGGCCAAGCGGGTCAACGTGGTGGGGCTCTGCTGCACCGGCAACGAGGTG
CTGCTGCGCCAGGGGGTCGGCATGGCGGGGAACGAGTCCCACAGCGAGCTGGCCATCATGACCGGTGCCGTCGACGCCAT
GGTGGTGGACGTGCAGTGCATCTACCCGGCCCTGGCCGATCTCGCCTCCTGCTTCCACACCAAGTTCGTCACCACGAGCG
AACAGGCCAAGATCCCCGGCGCGCTCCACATCCAGTTCGAAGAGCACGAGGCCGACGCCATCGCCACCCGCATCATCAAG
ACCGCCATCGACGCCTTCCCGAACCGCAACAAGGCCCGTGTCTACATCCCGCAGCACACCAGCACCGCCATTGTCGGCTT
CACCGTGGAGGAGATCCTCAAGGCGCTCGGCGGAACGCCCCAGCCCCTGATCGACCTGATTGTCACGGGGACCATCAAGG
GGGTCGCCGGCATCGTCGGCTGCAACAACGTGAAGGTGCAGCAGGATTTCTTCCACCGCACCCTGACCGAGGAGCTGATC
AAGCGCGACATCCTCGTGATCGGCACCGGCTGCTGGGCCATTGCCGCGGCAAAGTCGGGGCTCATGGACCTGCCCGCCCG
CGAGCTGGCCGGACCGGGGCTCCAGGCGGTATGCGGCCAGCTGGGGATTCCACCGGTCCTCCACATGGGCTCGTGCGTCG
ACTGCTCGCGGATGCTCAACCTGGCCGGGGCCCTGGCGGATCACCTGCAGGTGGACATTTCCGATCTGCCCCTGGTCGGG
TCCGCGCCCGAATGGACCACGGAGAAGGCGGTCGCCATCGGCACCTATTTCGTCGGCTCGGGCATTCCCGTGCACCTGTG
GCCGCTGCCGCCCATCCTGGGCGGACCGCAGGTAACGAAGATCCTCACCAGCGACGCCAAGGATGTCCTGGGCGGGTGGT
TCTTCGTGGAGGAAGACCCGAAGGCCACGGCCGACCGGATGGAGCAGATCATCATGGAGCGGCGCGCCGCCCTCGGGATC
TGA

Upstream 100 bases:

>100_bases
CACAAGTCCCAGACACCTTCCGCAAGTGTCGGCTGGCATTTCATGGTCACTTCGGCTACAGGTAGGAAAACCACACCTGC
ACAACGCGAGGGAGGAGCAT

Downstream 100 bases:

>100_bases
CAGGGAGGGGAGTCGTCATGTGCCAGCCGCAGTCGCCCGGAATGCGCGTCGTGATTACCGGAAAGGGGGGGGTGGGGAAA
ACCACCCTCACCTCGTGCCT

Product: carbon monoxide dehydrogenase subunit

Products: NA

Alternate protein names: CODH 1 [H]

Number of amino acids: Translated: 640; Mature: 640

Protein sequence:

>640_residues
MDQARNGHDSRSIDPAAKEMLRIADREGYATIWERYEQQQPQCSYGQLGTCCRICSMGPCRIDPFGDGPTRGVCGATADT
MVARNLARMAAVGSSSHSDHGRKVALLLKAVANGSNTDYHIADPDKLTAVAERLGIPTAGRSTAEIAGDVAAVAIDCFGN
QGEEPIVFMEKYMPKKRFQRLRELEETLYRTTGAKTGLLPRAIDREAVDILHRTHFGCDHDPLSLVAQSVRCSLSDGWGG
SLIATELQDILLGSPIIRPVKANLGVLEAESVNVVVHGHEPILSAKVVEMAQSPECRAAAEAVGAKRVNVVGLCCTGNEV
LLRQGVGMAGNESHSELAIMTGAVDAMVVDVQCIYPALADLASCFHTKFVTTSEQAKIPGALHIQFEEHEADAIATRIIK
TAIDAFPNRNKARVYIPQHTSTAIVGFTVEEILKALGGTPQPLIDLIVTGTIKGVAGIVGCNNVKVQQDFFHRTLTEELI
KRDILVIGTGCWAIAAAKSGLMDLPARELAGPGLQAVCGQLGIPPVLHMGSCVDCSRMLNLAGALADHLQVDISDLPLVG
SAPEWTTEKAVAIGTYFVGSGIPVHLWPLPPILGGPQVTKILTSDAKDVLGGWFFVEEDPKATADRMEQIIMERRAALGI

Sequences:

>Translated_640_residues
MDQARNGHDSRSIDPAAKEMLRIADREGYATIWERYEQQQPQCSYGQLGTCCRICSMGPCRIDPFGDGPTRGVCGATADT
MVARNLARMAAVGSSSHSDHGRKVALLLKAVANGSNTDYHIADPDKLTAVAERLGIPTAGRSTAEIAGDVAAVAIDCFGN
QGEEPIVFMEKYMPKKRFQRLRELEETLYRTTGAKTGLLPRAIDREAVDILHRTHFGCDHDPLSLVAQSVRCSLSDGWGG
SLIATELQDILLGSPIIRPVKANLGVLEAESVNVVVHGHEPILSAKVVEMAQSPECRAAAEAVGAKRVNVVGLCCTGNEV
LLRQGVGMAGNESHSELAIMTGAVDAMVVDVQCIYPALADLASCFHTKFVTTSEQAKIPGALHIQFEEHEADAIATRIIK
TAIDAFPNRNKARVYIPQHTSTAIVGFTVEEILKALGGTPQPLIDLIVTGTIKGVAGIVGCNNVKVQQDFFHRTLTEELI
KRDILVIGTGCWAIAAAKSGLMDLPARELAGPGLQAVCGQLGIPPVLHMGSCVDCSRMLNLAGALADHLQVDISDLPLVG
SAPEWTTEKAVAIGTYFVGSGIPVHLWPLPPILGGPQVTKILTSDAKDVLGGWFFVEEDPKATADRMEQIIMERRAALGI
>Mature_640_residues
MDQARNGHDSRSIDPAAKEMLRIADREGYATIWERYEQQQPQCSYGQLGTCCRICSMGPCRIDPFGDGPTRGVCGATADT
MVARNLARMAAVGSSSHSDHGRKVALLLKAVANGSNTDYHIADPDKLTAVAERLGIPTAGRSTAEIAGDVAAVAIDCFGN
QGEEPIVFMEKYMPKKRFQRLRELEETLYRTTGAKTGLLPRAIDREAVDILHRTHFGCDHDPLSLVAQSVRCSLSDGWGG
SLIATELQDILLGSPIIRPVKANLGVLEAESVNVVVHGHEPILSAKVVEMAQSPECRAAAEAVGAKRVNVVGLCCTGNEV
LLRQGVGMAGNESHSELAIMTGAVDAMVVDVQCIYPALADLASCFHTKFVTTSEQAKIPGALHIQFEEHEADAIATRIIK
TAIDAFPNRNKARVYIPQHTSTAIVGFTVEEILKALGGTPQPLIDLIVTGTIKGVAGIVGCNNVKVQQDFFHRTLTEELI
KRDILVIGTGCWAIAAAKSGLMDLPARELAGPGLQAVCGQLGIPPVLHMGSCVDCSRMLNLAGALADHLQVDISDLPLVG
SAPEWTTEKAVAIGTYFVGSGIPVHLWPLPPILGGPQVTKILTSDAKDVLGGWFFVEEDPKATADRMEQIIMERRAALGI

Specific function: Unknown

COG id: COG1151

COG function: function code C; 6Fe-6S prismane cluster-containing protein

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Belongs to the Ni-containing carbon monoxide dehydrogenase family [H]

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR016101
- InterPro:   IPR010047
- InterPro:   IPR004137
- InterPro:   IPR011254
- InterPro:   IPR016099 [H]

Pfam domain/function: PF03063 Prismane [H]

EC number: =1.2.99.2 [H]

Molecular weight: Translated: 68403; Mature: 68403

Theoretical pI: Translated: 5.93; Mature: 5.93

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

3.0 %Cys     (Translated Protein)
2.5 %Met     (Translated Protein)
5.5 %Cys+Met (Translated Protein)
3.0 %Cys     (Mature Protein)
2.5 %Met     (Mature Protein)
5.5 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MDQARNGHDSRSIDPAAKEMLRIADREGYATIWERYEQQQPQCSYGQLGTCCRICSMGPC
CCCCCCCCCCCCCCHHHHHHHHHHCCCCHHHHHHHHHHCCCCCCCCCHHHHHHHHCCCCC
RIDPFGDGPTRGVCGATADTMVARNLARMAAVGSSSHSDHGRKVALLLKAVANGSNTDYH
CCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHCCCCCCEE
IADPDKLTAVAERLGIPTAGRSTAEIAGDVAAVAIDCFGNQGEEPIVFMEKYMPKKRFQR
ECCCHHHHHHHHHHCCCCCCCCHHHHHCCHHEEEEEECCCCCCCCEEEHHHCCCHHHHHH
LRELEETLYRTTGAKTGLLPRAIDREAVDILHRTHFGCDHDPLSLVAQSVRCSLSDGWGG
HHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHEECCCCCCC
SLIATELQDILLGSPIIRPVKANLGVLEAESVNVVVHGHEPILSAKVVEMAQSPECRAAA
CHHHHHHHHHHHCCCCCHHHHCCCCEEEECCEEEEEECCCCHHHHHHHHHHCCCCHHHHH
EAVGAKRVNVVGLCCTGNEVLLRQGVGMAGNESHSELAIMTGAVDAMVVDVQCIYPALAD
HHHCCCCEEEEEEEECCCHHHHHCCCCCCCCCCCCEEEEEECCCCEEEEHHHHHHHHHHH
LASCFHTKFVTTSEQAKIPGALHIQFEEHEADAIATRIIKTAIDAFPNRNKARVYIPQHT
HHHHHHHHHCCCCCCCCCCCEEEEEECCCCHHHHHHHHHHHHHHHCCCCCCEEEEEECCC
STAIVGFTVEEILKALGGTPQPLIDLIVTGTIKGVAGIVGCNNVKVQQDFFHRTLTEELI
CCEEEEECHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHCCCCCCEEHHHHHHHHHHHHHH
KRDILVIGTGCWAIAAAKSGLMDLPARELAGPGLQAVCGQLGIPPVLHMGSCVDCSRMLN
HCCEEEEECCHHHHHHHHCCCCCCCHHHHCCCCHHHHHHHCCCCHHHHCCCCCCHHHHHH
LAGALADHLQVDISDLPLVGSAPEWTTEKAVAIGTYFVGSGIPVHLWPLPPILGGPQVTK
HHHHHHHHHEECCCCCCCCCCCCCCCCCCEEEEEEEEECCCCEEEEECCCCCCCCCHHHH
ILTSDAKDVLGGWFFVEEDPKATADRMEQIIMERRAALGI
HHHHCHHHHHCCEEEEECCCCHHHHHHHHHHHHHHHHCCC
>Mature Secondary Structure
MDQARNGHDSRSIDPAAKEMLRIADREGYATIWERYEQQQPQCSYGQLGTCCRICSMGPC
CCCCCCCCCCCCCCHHHHHHHHHHCCCCHHHHHHHHHHCCCCCCCCCHHHHHHHHCCCCC
RIDPFGDGPTRGVCGATADTMVARNLARMAAVGSSSHSDHGRKVALLLKAVANGSNTDYH
CCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHCCCCCCEE
IADPDKLTAVAERLGIPTAGRSTAEIAGDVAAVAIDCFGNQGEEPIVFMEKYMPKKRFQR
ECCCHHHHHHHHHHCCCCCCCCHHHHHCCHHEEEEEECCCCCCCCEEEHHHCCCHHHHHH
LRELEETLYRTTGAKTGLLPRAIDREAVDILHRTHFGCDHDPLSLVAQSVRCSLSDGWGG
HHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHEECCCCCCC
SLIATELQDILLGSPIIRPVKANLGVLEAESVNVVVHGHEPILSAKVVEMAQSPECRAAA
CHHHHHHHHHHHCCCCCHHHHCCCCEEEECCEEEEEECCCCHHHHHHHHHHCCCCHHHHH
EAVGAKRVNVVGLCCTGNEVLLRQGVGMAGNESHSELAIMTGAVDAMVVDVQCIYPALAD
HHHCCCCEEEEEEEECCCHHHHHCCCCCCCCCCCCEEEEEECCCCEEEEHHHHHHHHHHH
LASCFHTKFVTTSEQAKIPGALHIQFEEHEADAIATRIIKTAIDAFPNRNKARVYIPQHT
HHHHHHHHHCCCCCCCCCCCEEEEEECCCCHHHHHHHHHHHHHHHCCCCCCEEEEEECCC
STAIVGFTVEEILKALGGTPQPLIDLIVTGTIKGVAGIVGCNNVKVQQDFFHRTLTEELI
CCEEEEECHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHCCCCCCEEHHHHHHHHHHHHHH
KRDILVIGTGCWAIAAAKSGLMDLPARELAGPGLQAVCGQLGIPPVLHMGSCVDCSRMLN
HCCEEEEECCHHHHHHHHCCCCCCCHHHHCCCCHHHHHHHCCCCHHHHCCCCCCHHHHHH
LAGALADHLQVDISDLPLVGSAPEWTTEKAVAIGTYFVGSGIPVHLWPLPPILGGPQVTK
HHHHHHHHHEECCCCCCCCCCCCCCCCCCEEEEEEEEECCCCEEEEECCCCCCCCCHHHH
ILTSDAKDVLGGWFFVEEDPKATADRMEQIIMERRAALGI
HHHHCHHHHHCCEEEEECCCCHHHHHHHHHHHHHHHHCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 11932238 [H]