Definition Gloeobacter violaceus PCC 7421 chromosome, complete genome.
Accession NC_005125
Length 4,659,019

Click here to switch to the map view.

The map label for this gene is 37521473

Identifier: 37521473

GI number: 37521473

Start: 2023616

End: 2026345

Strand: Direct

Name: 37521473

Synonym: glr1904

Alternate gene names: NA

Gene position: 2023616-2026345 (Clockwise)

Preceding gene: 37521472

Following gene: 37521475

Centisome position: 43.43

GC content: 61.58

Gene sequence:

>2730_bases
GTGGGCGCTTGCACCCCCCCGCCGAGGAAGTTGGAGGTCTCGATGTACCAGCCCCTTCAAACTTGCTTTCGCAGGGATCT
CGTCATCGATGAGGTCGTCAAGGCGGGCGTCAAGTCCTACCGCATCAAGGACCCGGCGAGCGGGGAGACCTTCGAGTTTG
GCGAGGAAGAGTTTTTTCTCTGTCAGCTGATGGACGGCGCCCTGACGCCGCGCCAGATTATCGAGGCCTTCGAGGCGCGC
TTCGGCCTCAAGATGAGCGAAGAGGACTTCGAGCCTTTTTGTCGACAAATTGGCGAATACGGGTTGCTCGAGCGCTACAG
CGAACGCCGACAGACGACAGCCACGATCGTTGTCTCCGAGGCGCAGCCCTTCGCGGCGGGGGGTGCCTTTGAAGATACAG
GGGAGCCGGGGCAGGGCAAAAAGCCCAAAAGCGACATGCCCTACAAGTGGTACTACCCCGAGCTGGCGCCGGTGTTCGTG
CTGTTTGCCCGCCTGCTCGAACCGTTCCACCTGCTCTTTAAGCTCGCGTTTTTGCTGCTCATCCCGACCGTCCCGCTGAC
GCTGATTACGATCCTCAACAACCAGATCCTGTTTTTTCAGGATTTTTCAGAGTACTACTCGCCCATCGACGGGTTGACCA
AGCACATGGTCAACATCCTGGTGGTCAACAGCATCAGCAAAGTCGCCCAGGCCGTCGTCGCCTCCCATTACGGCGTGGCG
GTCGAGCAGTTCGGTCTGCAGATGCTCTTCGGCTTTTTTCCGCGCTTCACCGTCGGCAAGGGGCCGCTGTTCCGCCAACT
CACTCGCGAGCAGCAGATCTGGACCTTCGCGACTCCGATCCTCGTGCGCTTGCTGTTGTTTGTGTTGGGCGGCCTCACCT
GGTACCTCAACCACGGTTCGACCAACAGCATGAGCGCCTGGGCCGTGTCGCTGTGTTATATGGCCTTCGTGGATACGGTG
CTCGACTCCAACCCGCTCTGGCCGAGCGACGCCTACGGTGTGGTGGTGGCCTACTACCGGCTGCCGCCGAGTTTATTTAA
GCGCAACCGCCAGATTGTCGAGCGTCTGTTGCGTCTGCAGTGGCTGCCGGACACCATTCCCCTGGGCGACCGGTTGCGGA
TGACTTTTTTTGCGCTGGTCGGCGAGGTGGTCTGGCTGGCGTTTTTTGCCTACATTACTCTGCACAGCGCCGAGGCGCTG
CAAAAGCTGGTCCCCGATCTTTTGGGCGAAGGTCTGGGGATACTATTGTTTTGCCTGCCGTTCCCATTCGCTATCCATTG
GTGGTTACTCGTGCGCGACAAAACTCGGACTTCTAAAAAAGCTTCTTCGTCGTCGCCCCTGGGTTCTGACCAGGCGGCGA
TCACCCCGGCGGGCAAGCCGGACCATCTGCAACTGCCGGAAGGGGAGCAGGCGAATTTGCAACTGGCCTCCCAGGCATCG
GACGGCATTCTGGAGGCACCCGGATCGGCCCCGCCGCGCTTCGGCGGCGGCGTCAATCTTTGGGAAGTGTTCCGCAAAGG
TCTGCCCTGGCTTGTCCTGGCGGCTTTTGTCGTGATTTTAATGCTGCCCTATACCTACCACTACGGCGGGGCGATCCAGC
TGTTGCCTCCTCGCCAGCAGCCGATCGCCGTCGAAGTCGAAGGTGTGCTCGACAAGCTCTACTTCAAGGGCGGCGATCAA
AAGCTGATCAAGGCCGGCACCACCCTCGCGCTCTTGCGCTCGGTGGACACCCAGAATCAGGTGAACACGGGCCTTTCGGA
CGTGCGCACCAGAGAGGCGGCCTTGATCACTGCGCAGGAAGAATTGCGCAAGTTGCTGAGCATGCCCCGGCCCGAGGAGG
TGCAGGTGGCGCGCGATCAGGTGAGTGTCGCCCGCCAGGAAGTCTCGGTGGCCAAAAGCCAGCTGGTGACCGCCAAGAGC
AAAGCCGACTTCAGCGCCCGCGAAGCGGAGCGCAACTTGAAACTCAGCAAAGAAGGGGTCGTCTCCGATCAAGTCTACGA
AAACGCCAAGCGCGAAGCGGAGACCGAGCGCATCGGCGTCGAGACCGCCCAGGAGAGCCTGGCAAGCGCCGGGCAGCGCC
TGGAGCAGGCCCAGTCGAATTTGCGCCTGGTGATGGCCGGTCCCCACCCGCAGGAGATTTCCGCCGCCCGCAGCAAAGTG
GAGCAGGAGCGGGCCGAATTGAAGCGGGTCCAGGACCAGTACGCCTACTACCGCCAGCAGCTCAATTTCACCAAGGTGGT
GATGCCCTTTAACGGCTACATCATCACCCCCAACCTCGACTGGAAGGTCGGTAGCCGCATGCAGGTGGGCGATGTGCTGG
GAGTGGCCCAGCACGCCAGCCGCATCACCGGCACCATCCAGATGCCCGAGTACCAGGCGGGCGACGGCTTCAAGCCCGGC
GGCGAGGTGGAAGTGAAGCTATGGGCCTACCCGACCCGTTCGTTTGCAGGCAAGGTGGCCTCGATCGAACCGGTGGCCAC
CTCCTACAACAAGAACGACCCCCAGAACGTCACCAAGAGCGTCGAGTACGGCGCCGACCCGACCGAGTTGCTCAAGAGCA
CGACGCGCTACGTGAACGTCGTGGTCGACTTCCCGCAAGCCAAAGCCGAGATGAAGCCGGGCATGACCGGTTACGCGAAG
GTCACCGGCGAGACCCAGCCGGTCTTCCAGGCCTTCAGCCATCCGCTGGTGCGCTTTGTGACCGTCGAGCTGTGGTCCTG
GTTGCCGTAG

Upstream 100 bases:

>100_bases
GACGGTTATTTCGGCCACGGCCCGATCATGCACCCCAAGTGCTTTGAGATCCCCTTCCTCGAAGGTCTGCGCCCCGCCTA
GCACCTTGAAATCGCCGTCG

Downstream 100 bases:

>100_bases
TCGGCTAACTGCCCAGCTTCACCTGGTAGACGTTGCCTTCGCCCTCGTCGCTGACCAGCAGCGTCCGTTCATCCAAAAAG
AGGGCTTCGCGGGGTTTGCC

Product: hypothetical protein

Products: NA

Alternate protein names: None

Number of amino acids: Translated: 909; Mature: 908

Protein sequence:

>909_residues
MGACTPPPRKLEVSMYQPLQTCFRRDLVIDEVVKAGVKSYRIKDPASGETFEFGEEEFFLCQLMDGALTPRQIIEAFEAR
FGLKMSEEDFEPFCRQIGEYGLLERYSERRQTTATIVVSEAQPFAAGGAFEDTGEPGQGKKPKSDMPYKWYYPELAPVFV
LFARLLEPFHLLFKLAFLLLIPTVPLTLITILNNQILFFQDFSEYYSPIDGLTKHMVNILVVNSISKVAQAVVASHYGVA
VEQFGLQMLFGFFPRFTVGKGPLFRQLTREQQIWTFATPILVRLLLFVLGGLTWYLNHGSTNSMSAWAVSLCYMAFVDTV
LDSNPLWPSDAYGVVVAYYRLPPSLFKRNRQIVERLLRLQWLPDTIPLGDRLRMTFFALVGEVVWLAFFAYITLHSAEAL
QKLVPDLLGEGLGILLFCLPFPFAIHWWLLVRDKTRTSKKASSSSPLGSDQAAITPAGKPDHLQLPEGEQANLQLASQAS
DGILEAPGSAPPRFGGGVNLWEVFRKGLPWLVLAAFVVILMLPYTYHYGGAIQLLPPRQQPIAVEVEGVLDKLYFKGGDQ
KLIKAGTTLALLRSVDTQNQVNTGLSDVRTREAALITAQEELRKLLSMPRPEEVQVARDQVSVARQEVSVAKSQLVTAKS
KADFSAREAERNLKLSKEGVVSDQVYENAKREAETERIGVETAQESLASAGQRLEQAQSNLRLVMAGPHPQEISAARSKV
EQERAELKRVQDQYAYYRQQLNFTKVVMPFNGYIITPNLDWKVGSRMQVGDVLGVAQHASRITGTIQMPEYQAGDGFKPG
GEVEVKLWAYPTRSFAGKVASIEPVATSYNKNDPQNVTKSVEYGADPTELLKSTTRYVNVVVDFPQAKAEMKPGMTGYAK
VTGETQPVFQAFSHPLVRFVTVELWSWLP

Sequences:

>Translated_909_residues
MGACTPPPRKLEVSMYQPLQTCFRRDLVIDEVVKAGVKSYRIKDPASGETFEFGEEEFFLCQLMDGALTPRQIIEAFEAR
FGLKMSEEDFEPFCRQIGEYGLLERYSERRQTTATIVVSEAQPFAAGGAFEDTGEPGQGKKPKSDMPYKWYYPELAPVFV
LFARLLEPFHLLFKLAFLLLIPTVPLTLITILNNQILFFQDFSEYYSPIDGLTKHMVNILVVNSISKVAQAVVASHYGVA
VEQFGLQMLFGFFPRFTVGKGPLFRQLTREQQIWTFATPILVRLLLFVLGGLTWYLNHGSTNSMSAWAVSLCYMAFVDTV
LDSNPLWPSDAYGVVVAYYRLPPSLFKRNRQIVERLLRLQWLPDTIPLGDRLRMTFFALVGEVVWLAFFAYITLHSAEAL
QKLVPDLLGEGLGILLFCLPFPFAIHWWLLVRDKTRTSKKASSSSPLGSDQAAITPAGKPDHLQLPEGEQANLQLASQAS
DGILEAPGSAPPRFGGGVNLWEVFRKGLPWLVLAAFVVILMLPYTYHYGGAIQLLPPRQQPIAVEVEGVLDKLYFKGGDQ
KLIKAGTTLALLRSVDTQNQVNTGLSDVRTREAALITAQEELRKLLSMPRPEEVQVARDQVSVARQEVSVAKSQLVTAKS
KADFSAREAERNLKLSKEGVVSDQVYENAKREAETERIGVETAQESLASAGQRLEQAQSNLRLVMAGPHPQEISAARSKV
EQERAELKRVQDQYAYYRQQLNFTKVVMPFNGYIITPNLDWKVGSRMQVGDVLGVAQHASRITGTIQMPEYQAGDGFKPG
GEVEVKLWAYPTRSFAGKVASIEPVATSYNKNDPQNVTKSVEYGADPTELLKSTTRYVNVVVDFPQAKAEMKPGMTGYAK
VTGETQPVFQAFSHPLVRFVTVELWSWLP
>Mature_908_residues
GACTPPPRKLEVSMYQPLQTCFRRDLVIDEVVKAGVKSYRIKDPASGETFEFGEEEFFLCQLMDGALTPRQIIEAFEARF
GLKMSEEDFEPFCRQIGEYGLLERYSERRQTTATIVVSEAQPFAAGGAFEDTGEPGQGKKPKSDMPYKWYYPELAPVFVL
FARLLEPFHLLFKLAFLLLIPTVPLTLITILNNQILFFQDFSEYYSPIDGLTKHMVNILVVNSISKVAQAVVASHYGVAV
EQFGLQMLFGFFPRFTVGKGPLFRQLTREQQIWTFATPILVRLLLFVLGGLTWYLNHGSTNSMSAWAVSLCYMAFVDTVL
DSNPLWPSDAYGVVVAYYRLPPSLFKRNRQIVERLLRLQWLPDTIPLGDRLRMTFFALVGEVVWLAFFAYITLHSAEALQ
KLVPDLLGEGLGILLFCLPFPFAIHWWLLVRDKTRTSKKASSSSPLGSDQAAITPAGKPDHLQLPEGEQANLQLASQASD
GILEAPGSAPPRFGGGVNLWEVFRKGLPWLVLAAFVVILMLPYTYHYGGAIQLLPPRQQPIAVEVEGVLDKLYFKGGDQK
LIKAGTTLALLRSVDTQNQVNTGLSDVRTREAALITAQEELRKLLSMPRPEEVQVARDQVSVARQEVSVAKSQLVTAKSK
ADFSAREAERNLKLSKEGVVSDQVYENAKREAETERIGVETAQESLASAGQRLEQAQSNLRLVMAGPHPQEISAARSKVE
QERAELKRVQDQYAYYRQQLNFTKVVMPFNGYIITPNLDWKVGSRMQVGDVLGVAQHASRITGTIQMPEYQAGDGFKPGG
EVEVKLWAYPTRSFAGKVASIEPVATSYNKNDPQNVTKSVEYGADPTELLKSTTRYVNVVVDFPQAKAEMKPGMTGYAKV
TGETQPVFQAFSHPLVRFVTVELWSWLP

Specific function: Unknown

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 101601; Mature: 101470

Theoretical pI: Translated: 7.10; Mature: 7.10

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.7 %Cys     (Translated Protein)
2.0 %Met     (Translated Protein)
2.6 %Cys+Met (Translated Protein)
0.7 %Cys     (Mature Protein)
1.9 %Met     (Mature Protein)
2.5 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MGACTPPPRKLEVSMYQPLQTCFRRDLVIDEVVKAGVKSYRIKDPASGETFEFGEEEFFL
CCCCCCCCCCEEHHHHHHHHHHHHHHHHHHHHHHHHHHHEECCCCCCCCCCCCCCCCEEH
CQLMDGALTPRQIIEAFEARFGLKMSEEDFEPFCRQIGEYGLLERYSERRQTTATIVVSE
HHHHCCCCCHHHHHHHHHHHHCCCCCHHHHHHHHHHHCCHHHHHHHHHHHCCEEEEEEEC
AQPFAAGGAFEDTGEPGQGKKPKSDMPYKWYYPELAPVFVLFARLLEPFHLLFKLAFLLL
CCCCCCCCCCCCCCCCCCCCCCCCCCCEEEECCCHHHHHHHHHHHHHHHHHHHHHHHHHH
IPTVPLTLITILNNQILFFQDFSEYYSPIDGLTKHMVNILVVNSISKVAQAVVASHYGVA
HHHHHHHHHHHHCCCEEEEECHHHHHCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHH
VEQFGLQMLFGFFPRFTVGKGPLFRQLTREQQIWTFATPILVRLLLFVLGGLTWYLNHGS
HHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCEEEEECCC
TNSMSAWAVSLCYMAFVDTVLDSNPLWPSDAYGVVVAYYRLPPSLFKRNRQIVERLLRLQ
CCCHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCEEEEECCCHHHHHCCHHHHHHHHHHH
WLPDTIPLGDRLRMTFFALVGEVVWLAFFAYITLHSAEALQKLVPDLLGEGLGILLFCLP
CCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHH
FPFAIHWWLLVRDKTRTSKKASSSSPLGSDQAAITPAGKPDHLQLPEGEQANLQLASQAS
HHHHHEEHHEEECCHHHHHCCCCCCCCCCCCCEECCCCCCCCCCCCCCCCCCEEECCCCC
DGILEAPGSAPPRFGGGVNLWEVFRKGLPWLVLAAFVVILMLPYTYHYGGAIQLLPPRQQ
CCCEECCCCCCCCCCCCCCHHHHHHCCCCHHHHHHHHHHHHHHHHCCCCCEEEECCCCCC
PIAVEVEGVLDKLYFKGGDQKLIKAGTTLALLRSVDTQNQVNTGLSDVRTREAALITAQE
CEEEEHHHHHHHHHHCCCCHHHHHHCHHHHHHHHHCCCHHHHCCHHHHHHHHHHEEEHHH
ELRKLLSMPRPEEVQVARDQVSVARQEVSVAKSQLVTAKSKADFSAREAERNLKLSKEGV
HHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHCCCCCCCCC
VSDQVYENAKREAETERIGVETAQESLASAGQRLEQAQSNLRLVMAGPHPQEISAARSKV
CHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCEEEEECCCCHHHHHHHHHH
EQERAELKRVQDQYAYYRQQLNFTKVVMPFNGYIITPNLDWKVGSRMQVGDVLGVAQHAS
HHHHHHHHHHHHHHHHHHHHCCCEEEEEECCCEEECCCCCCCCCCCCCHHHHHHHHHHHH
RITGTIQMPEYQAGDGFKPGGEVEVKLWAYPTRSFAGKVASIEPVATSYNKNDPQNVTKS
HHEEEEECCCCCCCCCCCCCCCEEEEEEECCCHHHHCCCCCCCHHHHCCCCCCHHHHHHH
VEYGADPTELLKSTTRYVNVVVDFPQAKAEMKPGMTGYAKVTGETQPVFQAFSHPLVRFV
HHCCCCHHHHHHHHHHHEEEEEECCHHHHHCCCCCCCEEEECCCCHHHHHHHHHHHHHHH
TVELWSWLP
HHHHHHCCC
>Mature Secondary Structure 
GACTPPPRKLEVSMYQPLQTCFRRDLVIDEVVKAGVKSYRIKDPASGETFEFGEEEFFL
CCCCCCCCCEEHHHHHHHHHHHHHHHHHHHHHHHHHHHEECCCCCCCCCCCCCCCCEEH
CQLMDGALTPRQIIEAFEARFGLKMSEEDFEPFCRQIGEYGLLERYSERRQTTATIVVSE
HHHHCCCCCHHHHHHHHHHHHCCCCCHHHHHHHHHHHCCHHHHHHHHHHHCCEEEEEEEC
AQPFAAGGAFEDTGEPGQGKKPKSDMPYKWYYPELAPVFVLFARLLEPFHLLFKLAFLLL
CCCCCCCCCCCCCCCCCCCCCCCCCCCEEEECCCHHHHHHHHHHHHHHHHHHHHHHHHHH
IPTVPLTLITILNNQILFFQDFSEYYSPIDGLTKHMVNILVVNSISKVAQAVVASHYGVA
HHHHHHHHHHHHCCCEEEEECHHHHHCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHH
VEQFGLQMLFGFFPRFTVGKGPLFRQLTREQQIWTFATPILVRLLLFVLGGLTWYLNHGS
HHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCEEEEECCC
TNSMSAWAVSLCYMAFVDTVLDSNPLWPSDAYGVVVAYYRLPPSLFKRNRQIVERLLRLQ
CCCHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCEEEEECCCHHHHHCCHHHHHHHHHHH
WLPDTIPLGDRLRMTFFALVGEVVWLAFFAYITLHSAEALQKLVPDLLGEGLGILLFCLP
CCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHH
FPFAIHWWLLVRDKTRTSKKASSSSPLGSDQAAITPAGKPDHLQLPEGEQANLQLASQAS
HHHHHEEHHEEECCHHHHHCCCCCCCCCCCCCEECCCCCCCCCCCCCCCCCCEEECCCCC
DGILEAPGSAPPRFGGGVNLWEVFRKGLPWLVLAAFVVILMLPYTYHYGGAIQLLPPRQQ
CCCEECCCCCCCCCCCCCCHHHHHHCCCCHHHHHHHHHHHHHHHHCCCCCEEEECCCCCC
PIAVEVEGVLDKLYFKGGDQKLIKAGTTLALLRSVDTQNQVNTGLSDVRTREAALITAQE
CEEEEHHHHHHHHHHCCCCHHHHHHCHHHHHHHHHCCCHHHHCCHHHHHHHHHHEEEHHH
ELRKLLSMPRPEEVQVARDQVSVARQEVSVAKSQLVTAKSKADFSAREAERNLKLSKEGV
HHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHCCCCCCCCC
VSDQVYENAKREAETERIGVETAQESLASAGQRLEQAQSNLRLVMAGPHPQEISAARSKV
CHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCEEEEECCCCHHHHHHHHHH
EQERAELKRVQDQYAYYRQQLNFTKVVMPFNGYIITPNLDWKVGSRMQVGDVLGVAQHAS
HHHHHHHHHHHHHHHHHHHHCCCEEEEEECCCEEECCCCCCCCCCCCCHHHHHHHHHHHH
RITGTIQMPEYQAGDGFKPGGEVEVKLWAYPTRSFAGKVASIEPVATSYNKNDPQNVTKS
HHEEEEECCCCCCCCCCCCCCCEEEEEEECCCHHHHCCCCCCCHHHHCCCCCCHHHHHHH
VEYGADPTELLKSTTRYVNVVVDFPQAKAEMKPGMTGYAKVTGETQPVFQAFSHPLVRFV
HHCCCCHHHHHHHHHHHEEEEEECCHHHHHCCCCCCCEEEECCCCHHHHHHHHHHHHHHH
TVELWSWLP
HHHHHHCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA