| Definition | Nostoc sp. PCC 7120, complete genome. |
|---|---|
| Accession | NC_003272 |
| Length | 6,413,771 |
Click here to switch to the map view.
The map label for this gene is yegI [H]
Identifier: 17230316
GI number: 17230316
Start: 3438414
End: 3440612
Strand: Direct
Name: yegI [H]
Synonym: alr2824
Alternate gene names: 17230316
Gene position: 3438414-3440612 (Clockwise)
Preceding gene: 17230315
Following gene: 17230317
Centisome position: 53.61
GC content: 46.16
Gene sequence:
>2199_bases ATGAAGGTACTACGTTATCTTCCTCAGGAAGAGATTATCAGCCTCAGCGTGAGTTTGGGGCGTGGCGGTGAAGCGTGTAT TTATGCTGTGCCGTCGGCCGGTGATTGTGTGGCAAAGATTTATCACAAGCCGACAGTTGCCCACGCCAGCAAACTCCGGG CTATGCTTGCTAACCCACCGGAAAATCCTACGGCTAGTTTGGGTCATATTTCCATTGCTTGGCCGCAAGAATTATTGTGG GGAGCAGATGAAAGCGAACGCGTTATTGGCTTTTTGATGCCGCGTATTCGGGGGATGCGTCCCATCATCGACTTTTACAA CCCCCGGACTCGCCGTCAACACTGTCCTTTATTTAATTATCAGTACCTCCTGCGGACAGCGCGGAATTTGGCGGCGGCTT TTGCGGCTTTACATAATAGTGGCTATTCTGTAGGCGATGTCAACGAATCTAACATTTTGGTAAGTGACACAGCCCTGGTT ACCTTGGTAGATACGGATTCTTTCCAGGTATGTGACCCGGATAATGATATTGTTTATCGTTGCCCGGTAGGGAAACCAGA GTTTACCCCACCAGAACTACAGAATAAAATCTTTGCTCATCACGATCGCCAACCTACTCATGATTTATTTGGTTTAGGGG TGCTAATCTTCCAACTGCTGATGGAAGGTACCCATCCCTTTTCTGGTATTTATCAAGGCATTCCTGAACCACCACCTTAT GAAGCCAGAATTGCGTCGGGACATTTCACCTATAGTAAAAAACGGCAAGTACCTTACATACCTACTCCCATCGCCCCGCC TTGGGAAATTCTCCATCCCAGTTTACAAGCGCTGTTTATTCGTTGTTTTGAGGATGGTCACAATGAACCCCAACTGCGCC CTAATGCCCAAGCTTGGCTGTCGGCTATAGCTGAGGCTGAAGATTCCCTGACTACCTGTACAGTTAATTCTCAACATCAC TACAGTAATCACCTGCACAGTTGTCCTTGGTGCGAACGTGCTTTACGTTTGGGTGGTCGTGACCCATTTCCTTCGGTGCA AGCAATTGAAAATAGAGAACATCTCCGCCCCCGCATCCCCACCAAGAGACGCTACGGCCACAGCCATCAGCCTGCTAACT TGCCGCAGCCAGTGATGCCGATGTATCAAAGCAATTGGCATTCACCCACCCCCAGTTTTTCACCTTACCGCAATCGCTGG AAAGGAAAGTTTTATCCGGTAGTTTTTTGTTTGTTGGGTTTTGGGGTTTTGGGGTACTTGGATGTGGTGACAAAATTCAC CAGTCCTTTAGTATCGCGCAATAATTATGCTCAACAAGCGCTGATGCCTCAGCAAGCCAGTGGTAATATCGCCCTGAGTT TTGCAGAGTACTACAAACAGGGTCATGCTGCTTACCAAGTGCGTGATTATAAACAGGCAGTGGATAACTTCACCCATGCC ATTCAGCAGGAATCAGCAAATGCCAGAGTCTTGGTTAATCGAGGTAATGCGCGTTATAACCTGAAAGACTATGAAGGTGC TTTAGCTGATTACACGGCAGCTTTGCAAATTAATCCCAGAGAAATCAAAGCTTTTGTGAATCGGGGTAACTCCCGCTTAA TGCTGGCTGAATATAGCAATGACCCTGACCAACAGTATAGATTAGCGATCACCGACTTTAATCACGCCCTGAAACTCAAC GAGAAGGAAGCCGAAGCCTATATCCGCCGAGGGATTGTGCGAACGCAAATGGCTAAATATAGCAGCGACACCATTAAAGA TTACCAAGAAGCGATCACCGATTTTGACCAAGCCCTGAAACTTAATCCCGCGAAAACCGAAGCTTACTTTCAGCGTGCTT CCGTCCGCTATCTCATTGCCCAATATACAGGTGATTCGACAAAGGAATATGATCAGGCGATCGCCGATTTTGATCAAGCA TTAAAAATTAACGACAAACTAGCCAAAGTGTATCTTAAACGCGGCATGGTGCGTTACGAATTAGCACAAATTACTAGTAA TAAATCTGATGTCAATAACGCCAAAGCTCTTGCAGATTTACAGCTAGCCGCCAAACTTTCTTTAGAACAAGAAGATACAG AAAGTTATCAACAAGCACTCAGCAGTATCTGTATCATTGAGGAAAGCAAATGTAATGCTTTATTCCAAAGCTCTACAATG CGAGGATATGCCAGCACAGACTTGATAGCAAAACAGTAA
Upstream 100 bases:
>100_bases ATCATTTGTAAAGGTGTGTCAGTGGTCAGTCGTCAATAGTTTTCTTCTCCCCCTGCCCCCTGCCCCCTGCCTTTCTTATA CCCTTAACCGTAATTTAATC
Downstream 100 bases:
>100_bases TTAATTGTCAGTTGTCAGGTGTTAATAATCAATCATTTACATCGTCATTCGAGTTATACCAATTGGAAAAAAGAATGGGA CAAATGAACCATCTGTAGAG
Product: hypothetical protein
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 732; Mature: 732
Protein sequence:
>732_residues MKVLRYLPQEEIISLSVSLGRGGEACIYAVPSAGDCVAKIYHKPTVAHASKLRAMLANPPENPTASLGHISIAWPQELLW GADESERVIGFLMPRIRGMRPIIDFYNPRTRRQHCPLFNYQYLLRTARNLAAAFAALHNSGYSVGDVNESNILVSDTALV TLVDTDSFQVCDPDNDIVYRCPVGKPEFTPPELQNKIFAHHDRQPTHDLFGLGVLIFQLLMEGTHPFSGIYQGIPEPPPY EARIASGHFTYSKKRQVPYIPTPIAPPWEILHPSLQALFIRCFEDGHNEPQLRPNAQAWLSAIAEAEDSLTTCTVNSQHH YSNHLHSCPWCERALRLGGRDPFPSVQAIENREHLRPRIPTKRRYGHSHQPANLPQPVMPMYQSNWHSPTPSFSPYRNRW KGKFYPVVFCLLGFGVLGYLDVVTKFTSPLVSRNNYAQQALMPQQASGNIALSFAEYYKQGHAAYQVRDYKQAVDNFTHA IQQESANARVLVNRGNARYNLKDYEGALADYTAALQINPREIKAFVNRGNSRLMLAEYSNDPDQQYRLAITDFNHALKLN EKEAEAYIRRGIVRTQMAKYSSDTIKDYQEAITDFDQALKLNPAKTEAYFQRASVRYLIAQYTGDSTKEYDQAIADFDQA LKINDKLAKVYLKRGMVRYELAQITSNKSDVNNAKALADLQLAAKLSLEQEDTESYQQALSSICIIEESKCNALFQSSTM RGYASTDLIAKQ
Sequences:
>Translated_732_residues MKVLRYLPQEEIISLSVSLGRGGEACIYAVPSAGDCVAKIYHKPTVAHASKLRAMLANPPENPTASLGHISIAWPQELLW GADESERVIGFLMPRIRGMRPIIDFYNPRTRRQHCPLFNYQYLLRTARNLAAAFAALHNSGYSVGDVNESNILVSDTALV TLVDTDSFQVCDPDNDIVYRCPVGKPEFTPPELQNKIFAHHDRQPTHDLFGLGVLIFQLLMEGTHPFSGIYQGIPEPPPY EARIASGHFTYSKKRQVPYIPTPIAPPWEILHPSLQALFIRCFEDGHNEPQLRPNAQAWLSAIAEAEDSLTTCTVNSQHH YSNHLHSCPWCERALRLGGRDPFPSVQAIENREHLRPRIPTKRRYGHSHQPANLPQPVMPMYQSNWHSPTPSFSPYRNRW KGKFYPVVFCLLGFGVLGYLDVVTKFTSPLVSRNNYAQQALMPQQASGNIALSFAEYYKQGHAAYQVRDYKQAVDNFTHA IQQESANARVLVNRGNARYNLKDYEGALADYTAALQINPREIKAFVNRGNSRLMLAEYSNDPDQQYRLAITDFNHALKLN EKEAEAYIRRGIVRTQMAKYSSDTIKDYQEAITDFDQALKLNPAKTEAYFQRASVRYLIAQYTGDSTKEYDQAIADFDQA LKINDKLAKVYLKRGMVRYELAQITSNKSDVNNAKALADLQLAAKLSLEQEDTESYQQALSSICIIEESKCNALFQSSTM RGYASTDLIAKQ >Mature_732_residues MKVLRYLPQEEIISLSVSLGRGGEACIYAVPSAGDCVAKIYHKPTVAHASKLRAMLANPPENPTASLGHISIAWPQELLW GADESERVIGFLMPRIRGMRPIIDFYNPRTRRQHCPLFNYQYLLRTARNLAAAFAALHNSGYSVGDVNESNILVSDTALV TLVDTDSFQVCDPDNDIVYRCPVGKPEFTPPELQNKIFAHHDRQPTHDLFGLGVLIFQLLMEGTHPFSGIYQGIPEPPPY EARIASGHFTYSKKRQVPYIPTPIAPPWEILHPSLQALFIRCFEDGHNEPQLRPNAQAWLSAIAEAEDSLTTCTVNSQHH YSNHLHSCPWCERALRLGGRDPFPSVQAIENREHLRPRIPTKRRYGHSHQPANLPQPVMPMYQSNWHSPTPSFSPYRNRW KGKFYPVVFCLLGFGVLGYLDVVTKFTSPLVSRNNYAQQALMPQQASGNIALSFAEYYKQGHAAYQVRDYKQAVDNFTHA IQQESANARVLVNRGNARYNLKDYEGALADYTAALQINPREIKAFVNRGNSRLMLAEYSNDPDQQYRLAITDFNHALKLN EKEAEAYIRRGIVRTQMAKYSSDTIKDYQEAITDFDQALKLNPAKTEAYFQRASVRYLIAQYTGDSTKEYDQAIADFDQA LKINDKLAKVYLKRGMVRYELAQITSNKSDVNNAKALADLQLAAKLSLEQEDTESYQQALSSICIIEESKCNALFQSSTM RGYASTDLIAKQ
Specific function: Unknown
COG id: COG4248
COG function: function code R; Uncharacterized protein with protein kinase and helix-hairpin-helix DNA-binding domains
Gene ontology:
Cell location: Cytoplasmic
Metaboloic importance: Non Essential [C]
Operon status: Not Known
Operon components: None
Similarity: NA
Homologues:
Organism=Escherichia coli, GI1788385, Length=323, Percent_Identity=36.5325077399381, Blast_Score=206, Evalue=4e-54,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR003583 - InterPro: IPR011009 - InterPro: IPR000719 - InterPro: IPR016960 [H]
Pfam domain/function: NA
EC number: NA
Molecular weight: Translated: 82721; Mature: 82721
Theoretical pI: Translated: 8.03; Mature: 8.03
Prosite motif: PS50005 TPR ; PS50293 TPR_REGION ; PS50011 PROTEIN_KINASE_DOM
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.6 %Cys (Translated Protein) 1.6 %Met (Translated Protein) 3.3 %Cys+Met (Translated Protein) 1.6 %Cys (Mature Protein) 1.6 %Met (Mature Protein) 3.3 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MKVLRYLPQEEIISLSVSLGRGGEACIYAVPSAGDCVAKIYHKPTVAHASKLRAMLANPP CCHHHHCCHHHHEEEEEECCCCCCEEEEECCCCCHHHHHHHCCCHHHHHHHHHHHHCCCC ENPTASLGHISIAWPQELLWGADESERVIGFLMPRIRGMRPIIDFYNPRTRRQHCPLFNY CCCCCCCCEEEEECHHHHHCCCCCCHHHHHHHHHHHCCCCHHHHHCCCCCCCCCCCCCHH QYLLRTARNLAAAFAALHNSGYSVGDVNESNILVSDTALVTLVDTDSFQVCDPDNDIVYR HHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCEEEECCEEEEEEECCCEEEECCCCCEEEE CPVGKPEFTPPELQNKIFAHHDRQPTHDLFGLGVLIFQLLMEGTHPFSGIYQGIPEPPPY CCCCCCCCCCHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHCCCCCHHHHHCCCCCCCCC EARIASGHFTYSKKRQVPYIPTPIAPPWEILHPSLQALFIRCFEDGHNEPQLRPNAQAWL CCEEECCCEEECCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHH SAIAEAEDSLTTCTVNSQHHYSNHLHSCPWCERALRLGGRDPFPSVQAIENREHLRPRIP HHHHHHCCCCEEEEECCCHHHHHCCCCCHHHHHHHHCCCCCCCCCHHHHCCHHHCCCCCC TKRRYGHSHQPANLPQPVMPMYQSNWHSPTPSFSPYRNRWKGKFYPVVFCLLGFGVLGYL CHHHCCCCCCCCCCCCCCHHHHHCCCCCCCCCCCCHHHHCCCCHHHHHHHHHHHHHHHHH DVVTKFTSPLVSRNNYAQQALMPQQASGNIALSFAEYYKQGHAAYQVRDYKQAVDNFTHA HHHHHHHHHHHCCCCHHHHHCCCCCCCCCEEEEHHHHHHCCCCEEHHHHHHHHHHHHHHH IQQESANARVLVNRGNARYNLKDYEGALADYTAALQINPREIKAFVNRGNSRLMLAEYSN HHHCCCCCEEEEECCCCEECCHHHCCCHHHCEEEEEECHHHHHHHHHCCCCEEEEEECCC DPDQQYRLAITDFNHALKLNEKEAEAYIRRGIVRTQMAKYSSDTIKDYQEAITDFDQALK CCCCEEEEEEEECCCCEECCHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHC LNPAKTEAYFQRASVRYLIAQYTGDSTKEYDQAIADFDQALKINDKLAKVYLKRGMVRYE CCCHHHHHHHHHHHHHEEEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHCHHHHH LAQITSNKSDVNNAKALADLQLAAKLSLEQEDTESYQQALSSICIIEESKCNALFQSSTM HHHHHCCCCCCCHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHEEEECCHHHHHHHHCCC RGYASTDLIAKQ CCCCCCCHHCCC >Mature Secondary Structure MKVLRYLPQEEIISLSVSLGRGGEACIYAVPSAGDCVAKIYHKPTVAHASKLRAMLANPP CCHHHHCCHHHHEEEEEECCCCCCEEEEECCCCCHHHHHHHCCCHHHHHHHHHHHHCCCC ENPTASLGHISIAWPQELLWGADESERVIGFLMPRIRGMRPIIDFYNPRTRRQHCPLFNY CCCCCCCCEEEEECHHHHHCCCCCCHHHHHHHHHHHCCCCHHHHHCCCCCCCCCCCCCHH QYLLRTARNLAAAFAALHNSGYSVGDVNESNILVSDTALVTLVDTDSFQVCDPDNDIVYR HHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCEEEECCEEEEEEECCCEEEECCCCCEEEE CPVGKPEFTPPELQNKIFAHHDRQPTHDLFGLGVLIFQLLMEGTHPFSGIYQGIPEPPPY CCCCCCCCCCHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHCCCCCHHHHHCCCCCCCCC EARIASGHFTYSKKRQVPYIPTPIAPPWEILHPSLQALFIRCFEDGHNEPQLRPNAQAWL CCEEECCCEEECCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHH SAIAEAEDSLTTCTVNSQHHYSNHLHSCPWCERALRLGGRDPFPSVQAIENREHLRPRIP HHHHHHCCCCEEEEECCCHHHHHCCCCCHHHHHHHHCCCCCCCCCHHHHCCHHHCCCCCC TKRRYGHSHQPANLPQPVMPMYQSNWHSPTPSFSPYRNRWKGKFYPVVFCLLGFGVLGYL CHHHCCCCCCCCCCCCCCHHHHHCCCCCCCCCCCCHHHHCCCCHHHHHHHHHHHHHHHHH DVVTKFTSPLVSRNNYAQQALMPQQASGNIALSFAEYYKQGHAAYQVRDYKQAVDNFTHA HHHHHHHHHHHCCCCHHHHHCCCCCCCCCEEEEHHHHHHCCCCEEHHHHHHHHHHHHHHH IQQESANARVLVNRGNARYNLKDYEGALADYTAALQINPREIKAFVNRGNSRLMLAEYSN HHHCCCCCEEEEECCCCEECCHHHCCCHHHCEEEEEECHHHHHHHHHCCCCEEEEEECCC DPDQQYRLAITDFNHALKLNEKEAEAYIRRGIVRTQMAKYSSDTIKDYQEAITDFDQALK CCCCEEEEEEEECCCCEECCHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHC LNPAKTEAYFQRASVRYLIAQYTGDSTKEYDQAIADFDQALKINDKLAKVYLKRGMVRYE CCCHHHHHHHHHHHHHEEEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHCHHHHH LAQITSNKSDVNNAKALADLQLAAKLSLEQEDTESYQQALSSICIIEESKCNALFQSSTM HHHHHCCCCCCCHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHEEEECCHHHHHHHHCCC RGYASTDLIAKQ CCCCCCCHHCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: DNA [C]
Specific reaction: Protein + DNA = Protein-DNA [C]
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 9278503 [H]