Definition Nostoc sp. PCC 7120, complete genome.
Accession NC_003272
Length 6,413,771

Click here to switch to the map view.

The map label for this gene is yegI [H]

Identifier: 17230316

GI number: 17230316

Start: 3438414

End: 3440612

Strand: Direct

Name: yegI [H]

Synonym: alr2824

Alternate gene names: 17230316

Gene position: 3438414-3440612 (Clockwise)

Preceding gene: 17230315

Following gene: 17230317

Centisome position: 53.61

GC content: 46.16

Gene sequence:

>2199_bases
ATGAAGGTACTACGTTATCTTCCTCAGGAAGAGATTATCAGCCTCAGCGTGAGTTTGGGGCGTGGCGGTGAAGCGTGTAT
TTATGCTGTGCCGTCGGCCGGTGATTGTGTGGCAAAGATTTATCACAAGCCGACAGTTGCCCACGCCAGCAAACTCCGGG
CTATGCTTGCTAACCCACCGGAAAATCCTACGGCTAGTTTGGGTCATATTTCCATTGCTTGGCCGCAAGAATTATTGTGG
GGAGCAGATGAAAGCGAACGCGTTATTGGCTTTTTGATGCCGCGTATTCGGGGGATGCGTCCCATCATCGACTTTTACAA
CCCCCGGACTCGCCGTCAACACTGTCCTTTATTTAATTATCAGTACCTCCTGCGGACAGCGCGGAATTTGGCGGCGGCTT
TTGCGGCTTTACATAATAGTGGCTATTCTGTAGGCGATGTCAACGAATCTAACATTTTGGTAAGTGACACAGCCCTGGTT
ACCTTGGTAGATACGGATTCTTTCCAGGTATGTGACCCGGATAATGATATTGTTTATCGTTGCCCGGTAGGGAAACCAGA
GTTTACCCCACCAGAACTACAGAATAAAATCTTTGCTCATCACGATCGCCAACCTACTCATGATTTATTTGGTTTAGGGG
TGCTAATCTTCCAACTGCTGATGGAAGGTACCCATCCCTTTTCTGGTATTTATCAAGGCATTCCTGAACCACCACCTTAT
GAAGCCAGAATTGCGTCGGGACATTTCACCTATAGTAAAAAACGGCAAGTACCTTACATACCTACTCCCATCGCCCCGCC
TTGGGAAATTCTCCATCCCAGTTTACAAGCGCTGTTTATTCGTTGTTTTGAGGATGGTCACAATGAACCCCAACTGCGCC
CTAATGCCCAAGCTTGGCTGTCGGCTATAGCTGAGGCTGAAGATTCCCTGACTACCTGTACAGTTAATTCTCAACATCAC
TACAGTAATCACCTGCACAGTTGTCCTTGGTGCGAACGTGCTTTACGTTTGGGTGGTCGTGACCCATTTCCTTCGGTGCA
AGCAATTGAAAATAGAGAACATCTCCGCCCCCGCATCCCCACCAAGAGACGCTACGGCCACAGCCATCAGCCTGCTAACT
TGCCGCAGCCAGTGATGCCGATGTATCAAAGCAATTGGCATTCACCCACCCCCAGTTTTTCACCTTACCGCAATCGCTGG
AAAGGAAAGTTTTATCCGGTAGTTTTTTGTTTGTTGGGTTTTGGGGTTTTGGGGTACTTGGATGTGGTGACAAAATTCAC
CAGTCCTTTAGTATCGCGCAATAATTATGCTCAACAAGCGCTGATGCCTCAGCAAGCCAGTGGTAATATCGCCCTGAGTT
TTGCAGAGTACTACAAACAGGGTCATGCTGCTTACCAAGTGCGTGATTATAAACAGGCAGTGGATAACTTCACCCATGCC
ATTCAGCAGGAATCAGCAAATGCCAGAGTCTTGGTTAATCGAGGTAATGCGCGTTATAACCTGAAAGACTATGAAGGTGC
TTTAGCTGATTACACGGCAGCTTTGCAAATTAATCCCAGAGAAATCAAAGCTTTTGTGAATCGGGGTAACTCCCGCTTAA
TGCTGGCTGAATATAGCAATGACCCTGACCAACAGTATAGATTAGCGATCACCGACTTTAATCACGCCCTGAAACTCAAC
GAGAAGGAAGCCGAAGCCTATATCCGCCGAGGGATTGTGCGAACGCAAATGGCTAAATATAGCAGCGACACCATTAAAGA
TTACCAAGAAGCGATCACCGATTTTGACCAAGCCCTGAAACTTAATCCCGCGAAAACCGAAGCTTACTTTCAGCGTGCTT
CCGTCCGCTATCTCATTGCCCAATATACAGGTGATTCGACAAAGGAATATGATCAGGCGATCGCCGATTTTGATCAAGCA
TTAAAAATTAACGACAAACTAGCCAAAGTGTATCTTAAACGCGGCATGGTGCGTTACGAATTAGCACAAATTACTAGTAA
TAAATCTGATGTCAATAACGCCAAAGCTCTTGCAGATTTACAGCTAGCCGCCAAACTTTCTTTAGAACAAGAAGATACAG
AAAGTTATCAACAAGCACTCAGCAGTATCTGTATCATTGAGGAAAGCAAATGTAATGCTTTATTCCAAAGCTCTACAATG
CGAGGATATGCCAGCACAGACTTGATAGCAAAACAGTAA

Upstream 100 bases:

>100_bases
ATCATTTGTAAAGGTGTGTCAGTGGTCAGTCGTCAATAGTTTTCTTCTCCCCCTGCCCCCTGCCCCCTGCCTTTCTTATA
CCCTTAACCGTAATTTAATC

Downstream 100 bases:

>100_bases
TTAATTGTCAGTTGTCAGGTGTTAATAATCAATCATTTACATCGTCATTCGAGTTATACCAATTGGAAAAAAGAATGGGA
CAAATGAACCATCTGTAGAG

Product: hypothetical protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 732; Mature: 732

Protein sequence:

>732_residues
MKVLRYLPQEEIISLSVSLGRGGEACIYAVPSAGDCVAKIYHKPTVAHASKLRAMLANPPENPTASLGHISIAWPQELLW
GADESERVIGFLMPRIRGMRPIIDFYNPRTRRQHCPLFNYQYLLRTARNLAAAFAALHNSGYSVGDVNESNILVSDTALV
TLVDTDSFQVCDPDNDIVYRCPVGKPEFTPPELQNKIFAHHDRQPTHDLFGLGVLIFQLLMEGTHPFSGIYQGIPEPPPY
EARIASGHFTYSKKRQVPYIPTPIAPPWEILHPSLQALFIRCFEDGHNEPQLRPNAQAWLSAIAEAEDSLTTCTVNSQHH
YSNHLHSCPWCERALRLGGRDPFPSVQAIENREHLRPRIPTKRRYGHSHQPANLPQPVMPMYQSNWHSPTPSFSPYRNRW
KGKFYPVVFCLLGFGVLGYLDVVTKFTSPLVSRNNYAQQALMPQQASGNIALSFAEYYKQGHAAYQVRDYKQAVDNFTHA
IQQESANARVLVNRGNARYNLKDYEGALADYTAALQINPREIKAFVNRGNSRLMLAEYSNDPDQQYRLAITDFNHALKLN
EKEAEAYIRRGIVRTQMAKYSSDTIKDYQEAITDFDQALKLNPAKTEAYFQRASVRYLIAQYTGDSTKEYDQAIADFDQA
LKINDKLAKVYLKRGMVRYELAQITSNKSDVNNAKALADLQLAAKLSLEQEDTESYQQALSSICIIEESKCNALFQSSTM
RGYASTDLIAKQ

Sequences:

>Translated_732_residues
MKVLRYLPQEEIISLSVSLGRGGEACIYAVPSAGDCVAKIYHKPTVAHASKLRAMLANPPENPTASLGHISIAWPQELLW
GADESERVIGFLMPRIRGMRPIIDFYNPRTRRQHCPLFNYQYLLRTARNLAAAFAALHNSGYSVGDVNESNILVSDTALV
TLVDTDSFQVCDPDNDIVYRCPVGKPEFTPPELQNKIFAHHDRQPTHDLFGLGVLIFQLLMEGTHPFSGIYQGIPEPPPY
EARIASGHFTYSKKRQVPYIPTPIAPPWEILHPSLQALFIRCFEDGHNEPQLRPNAQAWLSAIAEAEDSLTTCTVNSQHH
YSNHLHSCPWCERALRLGGRDPFPSVQAIENREHLRPRIPTKRRYGHSHQPANLPQPVMPMYQSNWHSPTPSFSPYRNRW
KGKFYPVVFCLLGFGVLGYLDVVTKFTSPLVSRNNYAQQALMPQQASGNIALSFAEYYKQGHAAYQVRDYKQAVDNFTHA
IQQESANARVLVNRGNARYNLKDYEGALADYTAALQINPREIKAFVNRGNSRLMLAEYSNDPDQQYRLAITDFNHALKLN
EKEAEAYIRRGIVRTQMAKYSSDTIKDYQEAITDFDQALKLNPAKTEAYFQRASVRYLIAQYTGDSTKEYDQAIADFDQA
LKINDKLAKVYLKRGMVRYELAQITSNKSDVNNAKALADLQLAAKLSLEQEDTESYQQALSSICIIEESKCNALFQSSTM
RGYASTDLIAKQ
>Mature_732_residues
MKVLRYLPQEEIISLSVSLGRGGEACIYAVPSAGDCVAKIYHKPTVAHASKLRAMLANPPENPTASLGHISIAWPQELLW
GADESERVIGFLMPRIRGMRPIIDFYNPRTRRQHCPLFNYQYLLRTARNLAAAFAALHNSGYSVGDVNESNILVSDTALV
TLVDTDSFQVCDPDNDIVYRCPVGKPEFTPPELQNKIFAHHDRQPTHDLFGLGVLIFQLLMEGTHPFSGIYQGIPEPPPY
EARIASGHFTYSKKRQVPYIPTPIAPPWEILHPSLQALFIRCFEDGHNEPQLRPNAQAWLSAIAEAEDSLTTCTVNSQHH
YSNHLHSCPWCERALRLGGRDPFPSVQAIENREHLRPRIPTKRRYGHSHQPANLPQPVMPMYQSNWHSPTPSFSPYRNRW
KGKFYPVVFCLLGFGVLGYLDVVTKFTSPLVSRNNYAQQALMPQQASGNIALSFAEYYKQGHAAYQVRDYKQAVDNFTHA
IQQESANARVLVNRGNARYNLKDYEGALADYTAALQINPREIKAFVNRGNSRLMLAEYSNDPDQQYRLAITDFNHALKLN
EKEAEAYIRRGIVRTQMAKYSSDTIKDYQEAITDFDQALKLNPAKTEAYFQRASVRYLIAQYTGDSTKEYDQAIADFDQA
LKINDKLAKVYLKRGMVRYELAQITSNKSDVNNAKALADLQLAAKLSLEQEDTESYQQALSSICIIEESKCNALFQSSTM
RGYASTDLIAKQ

Specific function: Unknown

COG id: COG4248

COG function: function code R; Uncharacterized protein with protein kinase and helix-hairpin-helix DNA-binding domains

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: Non Essential [C]

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

Organism=Escherichia coli, GI1788385, Length=323, Percent_Identity=36.5325077399381, Blast_Score=206, Evalue=4e-54,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR003583
- InterPro:   IPR011009
- InterPro:   IPR000719
- InterPro:   IPR016960 [H]

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 82721; Mature: 82721

Theoretical pI: Translated: 8.03; Mature: 8.03

Prosite motif: PS50005 TPR ; PS50293 TPR_REGION ; PS50011 PROTEIN_KINASE_DOM

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.6 %Cys     (Translated Protein)
1.6 %Met     (Translated Protein)
3.3 %Cys+Met (Translated Protein)
1.6 %Cys     (Mature Protein)
1.6 %Met     (Mature Protein)
3.3 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKVLRYLPQEEIISLSVSLGRGGEACIYAVPSAGDCVAKIYHKPTVAHASKLRAMLANPP
CCHHHHCCHHHHEEEEEECCCCCCEEEEECCCCCHHHHHHHCCCHHHHHHHHHHHHCCCC
ENPTASLGHISIAWPQELLWGADESERVIGFLMPRIRGMRPIIDFYNPRTRRQHCPLFNY
CCCCCCCCEEEEECHHHHHCCCCCCHHHHHHHHHHHCCCCHHHHHCCCCCCCCCCCCCHH
QYLLRTARNLAAAFAALHNSGYSVGDVNESNILVSDTALVTLVDTDSFQVCDPDNDIVYR
HHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCEEEECCEEEEEEECCCEEEECCCCCEEEE
CPVGKPEFTPPELQNKIFAHHDRQPTHDLFGLGVLIFQLLMEGTHPFSGIYQGIPEPPPY
CCCCCCCCCCHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHCCCCCHHHHHCCCCCCCCC
EARIASGHFTYSKKRQVPYIPTPIAPPWEILHPSLQALFIRCFEDGHNEPQLRPNAQAWL
CCEEECCCEEECCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHH
SAIAEAEDSLTTCTVNSQHHYSNHLHSCPWCERALRLGGRDPFPSVQAIENREHLRPRIP
HHHHHHCCCCEEEEECCCHHHHHCCCCCHHHHHHHHCCCCCCCCCHHHHCCHHHCCCCCC
TKRRYGHSHQPANLPQPVMPMYQSNWHSPTPSFSPYRNRWKGKFYPVVFCLLGFGVLGYL
CHHHCCCCCCCCCCCCCCHHHHHCCCCCCCCCCCCHHHHCCCCHHHHHHHHHHHHHHHHH
DVVTKFTSPLVSRNNYAQQALMPQQASGNIALSFAEYYKQGHAAYQVRDYKQAVDNFTHA
HHHHHHHHHHHCCCCHHHHHCCCCCCCCCEEEEHHHHHHCCCCEEHHHHHHHHHHHHHHH
IQQESANARVLVNRGNARYNLKDYEGALADYTAALQINPREIKAFVNRGNSRLMLAEYSN
HHHCCCCCEEEEECCCCEECCHHHCCCHHHCEEEEEECHHHHHHHHHCCCCEEEEEECCC
DPDQQYRLAITDFNHALKLNEKEAEAYIRRGIVRTQMAKYSSDTIKDYQEAITDFDQALK
CCCCEEEEEEEECCCCEECCHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHC
LNPAKTEAYFQRASVRYLIAQYTGDSTKEYDQAIADFDQALKINDKLAKVYLKRGMVRYE
CCCHHHHHHHHHHHHHEEEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHCHHHHH
LAQITSNKSDVNNAKALADLQLAAKLSLEQEDTESYQQALSSICIIEESKCNALFQSSTM
HHHHHCCCCCCCHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHEEEECCHHHHHHHHCCC
RGYASTDLIAKQ
CCCCCCCHHCCC
>Mature Secondary Structure
MKVLRYLPQEEIISLSVSLGRGGEACIYAVPSAGDCVAKIYHKPTVAHASKLRAMLANPP
CCHHHHCCHHHHEEEEEECCCCCCEEEEECCCCCHHHHHHHCCCHHHHHHHHHHHHCCCC
ENPTASLGHISIAWPQELLWGADESERVIGFLMPRIRGMRPIIDFYNPRTRRQHCPLFNY
CCCCCCCCEEEEECHHHHHCCCCCCHHHHHHHHHHHCCCCHHHHHCCCCCCCCCCCCCHH
QYLLRTARNLAAAFAALHNSGYSVGDVNESNILVSDTALVTLVDTDSFQVCDPDNDIVYR
HHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCEEEECCEEEEEEECCCEEEECCCCCEEEE
CPVGKPEFTPPELQNKIFAHHDRQPTHDLFGLGVLIFQLLMEGTHPFSGIYQGIPEPPPY
CCCCCCCCCCHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHCCCCCHHHHHCCCCCCCCC
EARIASGHFTYSKKRQVPYIPTPIAPPWEILHPSLQALFIRCFEDGHNEPQLRPNAQAWL
CCEEECCCEEECCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHH
SAIAEAEDSLTTCTVNSQHHYSNHLHSCPWCERALRLGGRDPFPSVQAIENREHLRPRIP
HHHHHHCCCCEEEEECCCHHHHHCCCCCHHHHHHHHCCCCCCCCCHHHHCCHHHCCCCCC
TKRRYGHSHQPANLPQPVMPMYQSNWHSPTPSFSPYRNRWKGKFYPVVFCLLGFGVLGYL
CHHHCCCCCCCCCCCCCCHHHHHCCCCCCCCCCCCHHHHCCCCHHHHHHHHHHHHHHHHH
DVVTKFTSPLVSRNNYAQQALMPQQASGNIALSFAEYYKQGHAAYQVRDYKQAVDNFTHA
HHHHHHHHHHHCCCCHHHHHCCCCCCCCCEEEEHHHHHHCCCCEEHHHHHHHHHHHHHHH
IQQESANARVLVNRGNARYNLKDYEGALADYTAALQINPREIKAFVNRGNSRLMLAEYSN
HHHCCCCCEEEEECCCCEECCHHHCCCHHHCEEEEEECHHHHHHHHHCCCCEEEEEECCC
DPDQQYRLAITDFNHALKLNEKEAEAYIRRGIVRTQMAKYSSDTIKDYQEAITDFDQALK
CCCCEEEEEEEECCCCEECCHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHC
LNPAKTEAYFQRASVRYLIAQYTGDSTKEYDQAIADFDQALKINDKLAKVYLKRGMVRYE
CCCHHHHHHHHHHHHHEEEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHCHHHHH
LAQITSNKSDVNNAKALADLQLAAKLSLEQEDTESYQQALSSICIIEESKCNALFQSSTM
HHHHHCCCCCCCHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHEEEECCHHHHHHHHCCC
RGYASTDLIAKQ
CCCCCCCHHCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: DNA [C]

Specific reaction: Protein + DNA = Protein-DNA [C]

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 9278503 [H]