Definition Nostoc sp. PCC 7120, complete genome.
Accession NC_003272
Length 6,413,771

Click here to switch to the map view.

The map label for this gene is cobW [H]

Identifier: 17230884

GI number: 17230884

Start: 4099892

End: 4100932

Strand: Reverse

Name: cobW [H]

Synonym: all3392

Alternate gene names: 17230884

Gene position: 4100932-4099892 (Counterclockwise)

Preceding gene: 17230888

Following gene: 17230883

Centisome position: 63.94

GC content: 44.67

Gene sequence:

>1041_bases
ATGGCTCAAAAAATTCCCGTCACCGTAATTACAGGCTTTTTAGGTAGTGGTAAAACCAGCCTCATTCGCCACCTACTGCA
AAATAACGCCGGCCGCCGCATAGCAGTTTTAGTCAACGAGTTTGGCGAACTAGGTATAGATGGCGACTTGTTAAAATCCT
GTCAAGTTTGTCCCGAAGATGAGGACGGCGGGAGCAATATTTTTGAATTAACTAATGGCTGTCTATGCTGTACTGTCCAA
GAAGAGTTTTTGCCGACGATGCAGGAATTACTCAAACGAAGAGATAGCATTGATTGTATTGTCATTGAAACCTCTGGTTT
AGCCTTACCCAAACCATTGGTAAAAGCTTTTCGCTGGCAAGAAATCCGCAATGCTGCAACCGTGGATGCAGTTGTCACAG
TGGTAGATTGTGCGGCTGTTGCATCAGGAACATTTGCCAGTGATTTAGAAGCGATCGCCATCCAACGCCAAGCTGATGAT
AGTCTAGAACACGAAACACCATTGCAAGAATTGTTTGAAGACCAGCTAGCTTGTGCAGATTTGGTAGTTTTAAGCAAAAC
TGATTTAGTTGATGCTGCAACAAAATCACAAGTCGAGGAATTAGTCAAGCAAGAACTCCCCAGAGTAGTGAAAATGGTGG
AGAGCGATCGCGGTCAACTCGACCCATCTATACTATTAGGATTCCAAGCTGCCGTGGAAGACAACCTAGATAGTCGCCCC
AGCCATCACGACACCGAAGAAGACCACGACCACGACGACGATATCACCTCAACTCACCTCATTTTAGACCGGGACTTTGA
CCCAGAAAAACTGCAACAACAACTGCAAACACTCACAAATCAACAAGAAATCTACCGCATTAAAGGCTTTGTCGCCGTTC
CCAACAAACCCATGCGCCTAGTCATGCAAGGGGTAGGTAACAGATTTGATAAATTTTATGACCGCCCCTGGCAACCACAA
GAAGCCAGACAAACTCGTTTAGTTTTCATCGGTCGTGATTTAAACTCAACAGAAATAGAATCACAATTGGTAGCTTTGTA
A

Upstream 100 bases:

>100_bases
GCCTTGCCCGAATAGCAGATAATACAAATACAATCTAGATTTATTAATTACGAATTACTGTCATTTCTTACTCTCTTGAT
TTTGTTGATTTACTGAAATA

Downstream 100 bases:

>100_bases
TTTATCAACAAATTGGTAATTGGTGATCGAGTATTACCCATTACCCATTACCTAATCCCCATTCCCCATTCCCATAATGA
ACATCACTCAACTATTTAAC

Product: cobalamin synthesis protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 346; Mature: 345

Protein sequence:

>346_residues
MAQKIPVTVITGFLGSGKTSLIRHLLQNNAGRRIAVLVNEFGELGIDGDLLKSCQVCPEDEDGGSNIFELTNGCLCCTVQ
EEFLPTMQELLKRRDSIDCIVIETSGLALPKPLVKAFRWQEIRNAATVDAVVTVVDCAAVASGTFASDLEAIAIQRQADD
SLEHETPLQELFEDQLACADLVVLSKTDLVDAATKSQVEELVKQELPRVVKMVESDRGQLDPSILLGFQAAVEDNLDSRP
SHHDTEEDHDHDDDITSTHLILDRDFDPEKLQQQLQTLTNQQEIYRIKGFVAVPNKPMRLVMQGVGNRFDKFYDRPWQPQ
EARQTRLVFIGRDLNSTEIESQLVAL

Sequences:

>Translated_346_residues
MAQKIPVTVITGFLGSGKTSLIRHLLQNNAGRRIAVLVNEFGELGIDGDLLKSCQVCPEDEDGGSNIFELTNGCLCCTVQ
EEFLPTMQELLKRRDSIDCIVIETSGLALPKPLVKAFRWQEIRNAATVDAVVTVVDCAAVASGTFASDLEAIAIQRQADD
SLEHETPLQELFEDQLACADLVVLSKTDLVDAATKSQVEELVKQELPRVVKMVESDRGQLDPSILLGFQAAVEDNLDSRP
SHHDTEEDHDHDDDITSTHLILDRDFDPEKLQQQLQTLTNQQEIYRIKGFVAVPNKPMRLVMQGVGNRFDKFYDRPWQPQ
EARQTRLVFIGRDLNSTEIESQLVAL
>Mature_345_residues
AQKIPVTVITGFLGSGKTSLIRHLLQNNAGRRIAVLVNEFGELGIDGDLLKSCQVCPEDEDGGSNIFELTNGCLCCTVQE
EFLPTMQELLKRRDSIDCIVIETSGLALPKPLVKAFRWQEIRNAATVDAVVTVVDCAAVASGTFASDLEAIAIQRQADDS
LEHETPLQELFEDQLACADLVVLSKTDLVDAATKSQVEELVKQELPRVVKMVESDRGQLDPSILLGFQAAVEDNLDSRPS
HHDTEEDHDHDDDITSTHLILDRDFDPEKLQQQLQTLTNQQEIYRIKGFVAVPNKPMRLVMQGVGNRFDKFYDRPWQPQE
ARQTRLVFIGRDLNSTEIESQLVAL

Specific function: Might be involved in cobalt reduction leading to cobalt(I) corrinoids [H]

COG id: COG0523

COG function: function code R; Putative GTPases (G3E family)

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 cobW C-terminal domain [H]

Homologues:

Organism=Homo sapiens, GI126722884, Length=362, Percent_Identity=27.3480662983425, Blast_Score=135, Evalue=7e-32,
Organism=Homo sapiens, GI33469141, Length=362, Percent_Identity=27.3480662983425, Blast_Score=135, Evalue=7e-32,
Organism=Homo sapiens, GI148727351, Length=362, Percent_Identity=27.3480662983425, Blast_Score=132, Evalue=4e-31,
Organism=Homo sapiens, GI146231952, Length=362, Percent_Identity=27.3480662983425, Blast_Score=129, Evalue=4e-30,
Organism=Homo sapiens, GI223941779, Length=359, Percent_Identity=26.4623955431755, Blast_Score=126, Evalue=2e-29,
Organism=Homo sapiens, GI223941776, Length=361, Percent_Identity=25.7617728531856, Blast_Score=114, Evalue=1e-25,
Organism=Homo sapiens, GI119120938, Length=138, Percent_Identity=36.231884057971, Blast_Score=99, Evalue=8e-21,
Organism=Escherichia coli, GI87082430, Length=352, Percent_Identity=30.6818181818182, Blast_Score=132, Evalue=2e-32,
Organism=Escherichia coli, GI1788499, Length=318, Percent_Identity=26.1006289308176, Blast_Score=86, Evalue=3e-18,
Organism=Saccharomyces cerevisiae, GI6324356, Length=372, Percent_Identity=26.3440860215054, Blast_Score=118, Evalue=1e-27,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR012824
- InterPro:   IPR003495
- InterPro:   IPR011629 [H]

Pfam domain/function: PF02492 cobW; PF07683 CobW_C [H]

EC number: NA

Molecular weight: Translated: 38579; Mature: 38448

Theoretical pI: Translated: 4.35; Mature: 4.35

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

2.3 %Cys     (Translated Protein)
1.4 %Met     (Translated Protein)
3.8 %Cys+Met (Translated Protein)
2.3 %Cys     (Mature Protein)
1.2 %Met     (Mature Protein)
3.5 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MAQKIPVTVITGFLGSGKTSLIRHLLQNNAGRRIAVLVNEFGELGIDGDLLKSCQVCPED
CCCCCCHHHEECCCCCCHHHHHHHHHHCCCCCEEEEEEHHHHCCCCCHHHHHHCCCCCCC
EDGGSNIFELTNGCLCCTVQEEFLPTMQELLKRRDSIDCIVIETSGLALPKPLVKAFRWQ
CCCCCCHHHHCCCEEEEEEHHHHHHHHHHHHHHCCCCCEEEEECCCCCCCHHHHHHHHHH
EIRNAATVDAVVTVVDCAAVASGTFASDLEAIAIQRQADDSLEHETPLQELFEDQLACAD
HHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHH
LVVLSKTDLVDAATKSQVEELVKQELPRVVKMVESDRGQLDPSILLGFQAAVEDNLDSRP
HHEECCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHCCCCCCC
SHHDTEEDHDHDDDITSTHLILDRDFDPEKLQQQLQTLTNQQEIYRIKGFVAVPNKPMRL
CCCCCCCCCCCCCCCCCEEEEEECCCCHHHHHHHHHHHHCHHHHHHEECEEECCCCHHHH
VMQGVGNRFDKFYDRPWQPQEARQTRLVFIGRDLNSTEIESQLVAL
HHHHHHHHHHHHCCCCCCCHHHCCCEEEEEECCCCCHHHHHHHHCC
>Mature Secondary Structure 
AQKIPVTVITGFLGSGKTSLIRHLLQNNAGRRIAVLVNEFGELGIDGDLLKSCQVCPED
CCCCCHHHEECCCCCCHHHHHHHHHHCCCCCEEEEEEHHHHCCCCCHHHHHHCCCCCCC
EDGGSNIFELTNGCLCCTVQEEFLPTMQELLKRRDSIDCIVIETSGLALPKPLVKAFRWQ
CCCCCCHHHHCCCEEEEEEHHHHHHHHHHHHHHCCCCCEEEEECCCCCCCHHHHHHHHHH
EIRNAATVDAVVTVVDCAAVASGTFASDLEAIAIQRQADDSLEHETPLQELFEDQLACAD
HHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHH
LVVLSKTDLVDAATKSQVEELVKQELPRVVKMVESDRGQLDPSILLGFQAAVEDNLDSRP
HHEECCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHCCCCCCC
SHHDTEEDHDHDDDITSTHLILDRDFDPEKLQQQLQTLTNQQEIYRIKGFVAVPNKPMRL
CCCCCCCCCCCCCCCCCEEEEEECCCCHHHHHHHHHHHHCHHHHHHEECEEECCCCHHHH
VMQGVGNRFDKFYDRPWQPQEARQTRLVFIGRDLNSTEIESQLVAL
HHHHHHHHHHHHCCCCCCCHHHCCCEEEEEECCCCCHHHHHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: 10984043 [H]