Definition Nostoc sp. PCC 7120, complete genome.
Accession NC_003272
Length 6,413,771

Click here to switch to the map view.

The map label for this gene is 17230323

Identifier: 17230323

GI number: 17230323

Start: 3446985

End: 3448298

Strand: Direct

Name: 17230323

Synonym: alr2831

Alternate gene names: NA

Gene position: 3446985-3448298 (Clockwise)

Preceding gene: 17230322

Following gene: 17230324

Centisome position: 53.74

GC content: 47.03

Gene sequence:

>1314_bases
ATGATTATTATTGATAACGCCTTAAAAGCTCGTGCTGCTGCTGGTAATCCCGTGAAAGTGGGAATGATTGGCGCTGGTTT
TATGGGTCGGGGTATTGCCAACCAAATTATTAATTCCGTTCCAGGGATGGAATTAGTTGCTATTTCTAACCGCAGTATTG
ATGGTGCGAAACGAGCTTATAGCGAAGCTGGTATCGAAGATATTGAAATTGTGGATTCTGTCGGTGAGTTAGAAAGTGCG
ATCGCTCAAGGTAAGTATACTATTACCGAAGATGCCACAATCATCTGCCAAGCCGACGGTATCGACGCAATTATCGAAGT
CACCGGTGCAGTAGAATTTGGCGCTCATGTGGTCATGGAAGCGATCGCCCACCGCAAACACGTTATCATGATGAATGCGG
AACTTGACGGTACAATCGGCCCCATTCTCAAAGTATATGCAGACAAAGCTGGCGTGATTCTCAGTGCTTGTGATGGCGAC
CAACCAGGGGTACAGATGAACCTTTACCGATTTGTCCAAAGCATTGGTCTGACTCCCTTGCTTTGCGGTAACATCAAAGG
CTTGCAAGACCCCTACCGCAACCCCACCACCCAAGAAGGATTCGCCAAGCGTTGGGGACAAAAAGCCCACATGGTAACCA
GCTTTGCTGATGGTAGCAAAATTTCCTTTGAACAGGCGATCGTGGCTAACGCTACAGGTATGAAAGTAGCCAAGCGGGGA
ATGTTGGGATATGACTTCACCGGTCATGTTGATGAGATGACCAATATGTACGATGTGGAACAACTCAAGCAACTAGGCGG
TATTGTTGATTATGTAGTCGGCGCAAAACCCGGCCCTGGTGTATATGTGTTTGCAACTCACGACGACCCCAAACAACGCC
ATTACCTCAACCTCTACAAATTAGGCGAAGGCCCCCTCTATAGCTTCTATACCCCCTACCACCTGTGCCATTTTGAAGTT
CCTTTATCTGTAGCCCGTGCAGTCCTCTTCTCTGATGCTGTCATGGCTCCTCTAGCAGGCCCCTCGGTAGATGTTATCAC
CACTGCCAAAATAGACCTCAAAGCAGGGGAAACCTTAGATGGCATTGGTTACTACATGACCTATGGACAATGTGAAAATT
CCGATATCGTCCAACAGCAAAACCTCTTACCAATGGGTCTAGCAGAAGGATGTCGTCTCAAACGTGATGTTCCTAAAGAT
CAAGTCCTCACCTACGATGATGTAGAACTACCAGAAGGCAGACTTTGTGACCAACTACGAGCCGAGCAAGACAAATATTT
TGCCCCAGAAAAAGTTCTGGTAACTGTTGGTTAA

Upstream 100 bases:

>100_bases
TAGCCCAGACCCAGTAGAAGCAGTTTGTTAAAAAATACTGAGTTGTGAGTAAGATATTCTGCTTCTGTTGCTTGTTTTAG
AAAATAAAGGATTAAGCAAA

Downstream 100 bases:

>100_bases
GGGAACACCAAAAAATGAATTAGCCACAATTGATTGTTTGGTAGGGTGCGTCAGTATGAAGATTTCTGAGTATAGTTAGG
TTCTATCGCACTGACGCACC

Product: hypothetical protein

Products: NA

Alternate protein names: SAF Domain Protein; NAD(P)-Dependent Oxidoreductase; Homoserine Dehydrogenase; Dihydrodipicolinate Reductase; Oxidoreductase; Oxidoreductase Domain Protein; Oxidoreductase Domain-Containing Protein; Oxidoreductase-Like; StrU Protein; Saf Domain Protein; SAF Domain Family Protein

Number of amino acids: Translated: 437; Mature: 437

Protein sequence:

>437_residues
MIIIDNALKARAAAGNPVKVGMIGAGFMGRGIANQIINSVPGMELVAISNRSIDGAKRAYSEAGIEDIEIVDSVGELESA
IAQGKYTITEDATIICQADGIDAIIEVTGAVEFGAHVVMEAIAHRKHVIMMNAELDGTIGPILKVYADKAGVILSACDGD
QPGVQMNLYRFVQSIGLTPLLCGNIKGLQDPYRNPTTQEGFAKRWGQKAHMVTSFADGSKISFEQAIVANATGMKVAKRG
MLGYDFTGHVDEMTNMYDVEQLKQLGGIVDYVVGAKPGPGVYVFATHDDPKQRHYLNLYKLGEGPLYSFYTPYHLCHFEV
PLSVARAVLFSDAVMAPLAGPSVDVITTAKIDLKAGETLDGIGYYMTYGQCENSDIVQQQNLLPMGLAEGCRLKRDVPKD
QVLTYDDVELPEGRLCDQLRAEQDKYFAPEKVLVTVG

Sequences:

>Translated_437_residues
MIIIDNALKARAAAGNPVKVGMIGAGFMGRGIANQIINSVPGMELVAISNRSIDGAKRAYSEAGIEDIEIVDSVGELESA
IAQGKYTITEDATIICQADGIDAIIEVTGAVEFGAHVVMEAIAHRKHVIMMNAELDGTIGPILKVYADKAGVILSACDGD
QPGVQMNLYRFVQSIGLTPLLCGNIKGLQDPYRNPTTQEGFAKRWGQKAHMVTSFADGSKISFEQAIVANATGMKVAKRG
MLGYDFTGHVDEMTNMYDVEQLKQLGGIVDYVVGAKPGPGVYVFATHDDPKQRHYLNLYKLGEGPLYSFYTPYHLCHFEV
PLSVARAVLFSDAVMAPLAGPSVDVITTAKIDLKAGETLDGIGYYMTYGQCENSDIVQQQNLLPMGLAEGCRLKRDVPKD
QVLTYDDVELPEGRLCDQLRAEQDKYFAPEKVLVTVG
>Mature_437_residues
MIIIDNALKARAAAGNPVKVGMIGAGFMGRGIANQIINSVPGMELVAISNRSIDGAKRAYSEAGIEDIEIVDSVGELESA
IAQGKYTITEDATIICQADGIDAIIEVTGAVEFGAHVVMEAIAHRKHVIMMNAELDGTIGPILKVYADKAGVILSACDGD
QPGVQMNLYRFVQSIGLTPLLCGNIKGLQDPYRNPTTQEGFAKRWGQKAHMVTSFADGSKISFEQAIVANATGMKVAKRG
MLGYDFTGHVDEMTNMYDVEQLKQLGGIVDYVVGAKPGPGVYVFATHDDPKQRHYLNLYKLGEGPLYSFYTPYHLCHFEV
PLSVARAVLFSDAVMAPLAGPSVDVITTAKIDLKAGETLDGIGYYMTYGQCENSDIVQQQNLLPMGLAEGCRLKRDVPKD
QVLTYDDVELPEGRLCDQLRAEQDKYFAPEKVLVTVG

Specific function: Unknown

COG id: COG4091

COG function: function code E; Predicted homoserine dehydrogenase

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 47249; Mature: 47249

Theoretical pI: Translated: 4.82; Mature: 4.82

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.6 %Cys     (Translated Protein)
3.7 %Met     (Translated Protein)
5.3 %Cys+Met (Translated Protein)
1.6 %Cys     (Mature Protein)
3.7 %Met     (Mature Protein)
5.3 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MIIIDNALKARAAAGNPVKVGMIGAGFMGRGIANQIINSVPGMELVAISNRSIDGAKRAY
CEEECCCHHHHHCCCCCEEEEEEECCHHCCHHHHHHHHHCCCCEEEEECCCCCCHHHHHH
SEAGIEDIEIVDSVGELESAIAQGKYTITEDATIICQADGIDAIIEVTGAVEFGAHVVME
HHCCCCHHHHHHHHHHHHHHHHCCCEEEECCCEEEEECCCCCEEEEECCHHHHHHHHHHH
AIAHRKHVIMMNAELDGTIGPILKVYADKAGVILSACDGDQPGVQMNLYRFVQSIGLTPL
HHHCCCEEEEEECCCCCCHHHHHHHHCCCCCEEEEECCCCCCCCCHHHHHHHHHHCCCEE
LCGNIKGLQDPYRNPTTQEGFAKRWGQKAHMVTSFADGSKISFEQAIVANATGMKVAKRG
EECCCCCCCCCCCCCCCCHHHHHHCCCCCEEEEEECCCCCCCHHHHHHCCCCCHHHHHCC
MLGYDFTGHVDEMTNMYDVEQLKQLGGIVDYVVGAKPGPGVYVFATHDDPKQRHYLNLYK
CCCCCCCCCHHHHHHHHHHHHHHHHCCHHHHHHCCCCCCCEEEEEECCCCCHHHEEEEEE
LGEGPLYSFYTPYHLCHFEVPLSVARAVLFSDAVMAPLAGPSVDVITTAKIDLKAGETLD
ECCCCEEEECCCEEEEEEECCHHHHHHHHHHHHHHHCCCCCCEEEEEEEEEEECCCCCCC
GIGYYMTYGQCENSDIVQQQNLLPMGLAEGCRLKRDVPKDQVLTYDDVELPEGRLCDQLR
CCEEEEEECCCCCCCHHHHCCCCCCCHHCCCCCCCCCCCCCEEEECCCCCCCCHHHHHHH
AEQDKYFAPEKVLVTVG
HHHCCCCCCCEEEEEEC
>Mature Secondary Structure
MIIIDNALKARAAAGNPVKVGMIGAGFMGRGIANQIINSVPGMELVAISNRSIDGAKRAY
CEEECCCHHHHHCCCCCEEEEEEECCHHCCHHHHHHHHHCCCCEEEEECCCCCCHHHHHH
SEAGIEDIEIVDSVGELESAIAQGKYTITEDATIICQADGIDAIIEVTGAVEFGAHVVME
HHCCCCHHHHHHHHHHHHHHHHCCCEEEECCCEEEEECCCCCEEEEECCHHHHHHHHHHH
AIAHRKHVIMMNAELDGTIGPILKVYADKAGVILSACDGDQPGVQMNLYRFVQSIGLTPL
HHHCCCEEEEEECCCCCCHHHHHHHHCCCCCEEEEECCCCCCCCCHHHHHHHHHHCCCEE
LCGNIKGLQDPYRNPTTQEGFAKRWGQKAHMVTSFADGSKISFEQAIVANATGMKVAKRG
EECCCCCCCCCCCCCCCCHHHHHHCCCCCEEEEEECCCCCCCHHHHHHCCCCCHHHHHCC
MLGYDFTGHVDEMTNMYDVEQLKQLGGIVDYVVGAKPGPGVYVFATHDDPKQRHYLNLYK
CCCCCCCCCHHHHHHHHHHHHHHHHCCHHHHHHCCCCCCCEEEEEECCCCCHHHEEEEEE
LGEGPLYSFYTPYHLCHFEVPLSVARAVLFSDAVMAPLAGPSVDVITTAKIDLKAGETLD
ECCCCEEEECCCEEEEEEECCHHHHHHHHHHHHHHHCCCCCCEEEEEEEEEEECCCCCCC
GIGYYMTYGQCENSDIVQQQNLLPMGLAEGCRLKRDVPKDQVLTYDDVELPEGRLCDQLR
CCEEEEEECCCCCCCHHHHCCCCCCCHHCCCCCCCCCCCCCEEEECCCCCCCCHHHHHHH
AEQDKYFAPEKVLVTVG
HHHCCCCCCCEEEEEEC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA