| Definition | Trichodesmium erythraeum IMS101 chromosome, complete genome. |
|---|---|
| Accession | NC_008312 |
| Length | 7,750,108 |
Click here to switch to the map view.
The map label for this gene is yejH [C]
Identifier: 113477812
GI number: 113477812
Start: 6797474
End: 6799246
Strand: Reverse
Name: yejH [C]
Synonym: Tery_4412
Alternate gene names: 113477812
Gene position: 6799246-6797474 (Counterclockwise)
Preceding gene: 113477815
Following gene: 113477810
Centisome position: 87.73
GC content: 39.48
Gene sequence:
>1773_bases ATGTATCGTAAACCAACTATCTCATTCGATCGCGGGACTCTTATCCTCCATCCCCCACCCCAGGGAAAAACTTGGATAGA CTACGCTACCTGGGATGACCGGGTAGAAAAATTCCGGGTTAGGGCAATAGACTATCGGCCTTTAGTAGAATTGTTAAAAG CAGAAAAAATCGACTTTATTGACAAAGCTAAAGAGTTTGCACCTCTTGAGCTCATTCCTAGTTTCGAGATGCTACCCTAC CCCCATCAGGAAGCTGCATTAAAAGCTTGGAAACAAAATAATAGAAATGGAGTTGTTATCCTCCCCACTGCTTCGGGTAA AACATATTTGGCACAACTAGCAATGCAGGCAACTCCCCGCAGTACCCTTGTAGTAGTGCCTACCCTAGATTTAATGCACC AATGGTATGCACATTTAAACGCAGCGTTTCCCGATGTAGAGGTAGGGTTGCTCGGAGGTGGTTCTAGGGATAAAACACCA ATTTTAGTAGCAACTTACGATAGTGCAACTATTCATGCCGAGACGATCGGAAATAAATATGCTCTATTAGTTTTCGATGA ATGCCACCACTTGCCCACTGATTTTTATCGGGTGATAGCCGAATACGCGATCTCTCCTTATCGCCTCGGTCTTACCGCTA CCCCTAACCGTTCCGATGGTCGTCATTCTGACCTAAATTATTTAATTGGACCTACCGTTTTTAGCAAAACTCCTGAAGAG TTAGCAGGTAGCGCCTTAGCTGACCATAAAATCGTGCAAATAATGGTTAAACTATCGCCACAAGAGCGTGAAGAATATAA CAAGTTAATGATAATTAGAAATGACTTTTTAACACAGGCAAATATTAAATTAGGTGGGGTAAATGGTTGGAAAAACTTTG TTATAGCGAGTGCTCGTTCTACTGCTGGTCGTCGAGCAATGCTAGCTCACCGTCAAGCTAAAGAAATTGCTCTTGGTACT GAGGGAAAATTGCGAACTTTAAGTAATTTACTGGTTCAACATTTCCCAGAACGTACCTTAATTTTTACAGCTGATAATAC TACAGTTTATCGAATTTCCCATGACTTTTTAATCCCGGCAATTACTCATCAAACACCTGTAAAAGAACGCCATGAAGTTT TAAGTAAATTTCGGACTGGGGAATATAAAACTATTGTAGCTTCTCATGTTTTAAATGAAGGTGTTGATGTTCCAGATGCG AGGGTAGCAGTTATTTTGTCTGGTACAGGTAGCGAACGAGAATATATTCAAAGGTTAGGTCGAGTTTTGCGTCGAGGTAG TGATAAAAATAAGTTAGCAATTTTGTATGAAGTTGTTACAGAAAATACTACTGAAGAGCAGACTTCTCGCAGACGTAGAG CTGGAATTAAGAGGAAAAAGTCTCATCAAGATCAAGATGAAAAACAGGAAAATTCCGTTGTTCAGCAGTTAGAAATTATT AAACCAGAACCTAATTATGAAATTAATAATCCAGCCGCTCAAGCTGTAGCTGAACCTGGAGTAAAATGGGATTATGAGAA AGAAAATGATGTAAAAACTCCAGAGGATAACTTGCCCAACCAAAAATTTGCTAAATCTCAAGAGCAAGACCAGGAAAAAA CAGAACTTCAACCATTAGAAAATATTCAGCCAGAACCGATTTATAGAATTAATAATTCTACTACTAAACTGGCTGCAGAA CCAGGTAAAAAGTATAAAGAATATGGGAAAGACAACCCTGAGGAAGAATCTGTTAAATCTCAAGAGCAAGAACAGGAAAA AACAGAACTTTAA
Upstream 100 bases:
>100_bases TTCAAACTTTAGATGTCCAATAATTTCCTAAAATTACTATAGCGTTAAAGTTCATGACTTTTAACTTTTCACTCCTGACT TTTAACTTGAAAACCCTATA
Downstream 100 bases:
>100_bases CTATTAGAAAATATTCAGCCAGAACCGATTTATATAATTAATAATTCTACTACTAAACTGGCTGCATAATCAGGTGTAAA ATATCGAAAATATGAGAAAG
Product: type III restriction enzyme, res subunit
Products: NA
Alternate protein names: Type III Restriction Res Subunit; DNA Repair Helicase; Helicase Domain-Containing Protein; Helicase Domain Protein; ATP-Dependent DNA Helicase; DNA Repair Helicase RAD; Type III Restriction Res Subunit Family; DNA Repair Helicase Rad; Superfamily II DNA/RNA Helicase; Helicase; DNA Helicase; DNA Repair Protein; DNA Repair Protein RAD; DNA/RNA Helicase; DNA Repair Protein Rad; DNA/RNA Helicase Superfamily II; Helicase-Like Protein; Helicase Protein; ATP-Dependent Helicase; DNA/RNA Repair Helicase; Helicase DNA Repair; Helicase DNA Repair Rad; XPB/RAD25-Related Helicase; DEAD/DEAH Box Helicase-Like; DNA-Helicase; DNA Or RNA Helicase Of Superfamily II; DNA Or RNA Helicase Of Superfamily Protein II; DEAD/DEAH Box Helicase; Helicase ATP-Dependent; DNA Or RNA Helicase; RAD25-Type DNA Repair Helicase; DNA Repair Related Protein; Restriction; Restriction Endonuclease Family Protein; Helicase ATP-Dependent Intein-Containing; DNA-Repair Protein; RNA Polymerase Sigma
Number of amino acids: Translated: 590; Mature: 590
Protein sequence:
>590_residues MYRKPTISFDRGTLILHPPPQGKTWIDYATWDDRVEKFRVRAIDYRPLVELLKAEKIDFIDKAKEFAPLELIPSFEMLPY PHQEAALKAWKQNNRNGVVILPTASGKTYLAQLAMQATPRSTLVVVPTLDLMHQWYAHLNAAFPDVEVGLLGGGSRDKTP ILVATYDSATIHAETIGNKYALLVFDECHHLPTDFYRVIAEYAISPYRLGLTATPNRSDGRHSDLNYLIGPTVFSKTPEE LAGSALADHKIVQIMVKLSPQEREEYNKLMIIRNDFLTQANIKLGGVNGWKNFVIASARSTAGRRAMLAHRQAKEIALGT EGKLRTLSNLLVQHFPERTLIFTADNTTVYRISHDFLIPAITHQTPVKERHEVLSKFRTGEYKTIVASHVLNEGVDVPDA RVAVILSGTGSEREYIQRLGRVLRRGSDKNKLAILYEVVTENTTEEQTSRRRRAGIKRKKSHQDQDEKQENSVVQQLEII KPEPNYEINNPAAQAVAEPGVKWDYEKENDVKTPEDNLPNQKFAKSQEQDQEKTELQPLENIQPEPIYRINNSTTKLAAE PGKKYKEYGKDNPEEESVKSQEQEQEKTEL
Sequences:
>Translated_590_residues MYRKPTISFDRGTLILHPPPQGKTWIDYATWDDRVEKFRVRAIDYRPLVELLKAEKIDFIDKAKEFAPLELIPSFEMLPY PHQEAALKAWKQNNRNGVVILPTASGKTYLAQLAMQATPRSTLVVVPTLDLMHQWYAHLNAAFPDVEVGLLGGGSRDKTP ILVATYDSATIHAETIGNKYALLVFDECHHLPTDFYRVIAEYAISPYRLGLTATPNRSDGRHSDLNYLIGPTVFSKTPEE LAGSALADHKIVQIMVKLSPQEREEYNKLMIIRNDFLTQANIKLGGVNGWKNFVIASARSTAGRRAMLAHRQAKEIALGT EGKLRTLSNLLVQHFPERTLIFTADNTTVYRISHDFLIPAITHQTPVKERHEVLSKFRTGEYKTIVASHVLNEGVDVPDA RVAVILSGTGSEREYIQRLGRVLRRGSDKNKLAILYEVVTENTTEEQTSRRRRAGIKRKKSHQDQDEKQENSVVQQLEII KPEPNYEINNPAAQAVAEPGVKWDYEKENDVKTPEDNLPNQKFAKSQEQDQEKTELQPLENIQPEPIYRINNSTTKLAAE PGKKYKEYGKDNPEEESVKSQEQEQEKTEL >Mature_590_residues MYRKPTISFDRGTLILHPPPQGKTWIDYATWDDRVEKFRVRAIDYRPLVELLKAEKIDFIDKAKEFAPLELIPSFEMLPY PHQEAALKAWKQNNRNGVVILPTASGKTYLAQLAMQATPRSTLVVVPTLDLMHQWYAHLNAAFPDVEVGLLGGGSRDKTP ILVATYDSATIHAETIGNKYALLVFDECHHLPTDFYRVIAEYAISPYRLGLTATPNRSDGRHSDLNYLIGPTVFSKTPEE LAGSALADHKIVQIMVKLSPQEREEYNKLMIIRNDFLTQANIKLGGVNGWKNFVIASARSTAGRRAMLAHRQAKEIALGT EGKLRTLSNLLVQHFPERTLIFTADNTTVYRISHDFLIPAITHQTPVKERHEVLSKFRTGEYKTIVASHVLNEGVDVPDA RVAVILSGTGSEREYIQRLGRVLRRGSDKNKLAILYEVVTENTTEEQTSRRRRAGIKRKKSHQDQDEKQENSVVQQLEII KPEPNYEINNPAAQAVAEPGVKWDYEKENDVKTPEDNLPNQKFAKSQEQDQEKTELQPLENIQPEPIYRINNSTTKLAAE PGKKYKEYGKDNPEEESVKSQEQEQEKTEL
Specific function: Unknown
COG id: COG1061
COG function: function code KL; DNA or RNA helicases of superfamily II
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: NA
Homologues:
Organism=Homo sapiens, GI4557563, Length=418, Percent_Identity=25.8373205741627, Blast_Score=100, Evalue=4e-21, Organism=Caenorhabditis elegans, GI17556358, Length=416, Percent_Identity=24.7596153846154, Blast_Score=108, Evalue=8e-24, Organism=Saccharomyces cerevisiae, GI6322048, Length=450, Percent_Identity=25.5555555555556, Blast_Score=109, Evalue=1e-24, Organism=Drosophila melanogaster, GI221331068, Length=404, Percent_Identity=26.2376237623762, Blast_Score=106, Evalue=6e-23, Organism=Drosophila melanogaster, GI24662247, Length=404, Percent_Identity=26.2376237623762, Blast_Score=106, Evalue=6e-23,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
NA
Pfam domain/function: NA
EC number: NA
Molecular weight: Translated: 67009; Mature: 67009
Theoretical pI: Translated: 7.32; Mature: 7.32
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.2 %Cys (Translated Protein) 1.2 %Met (Translated Protein) 1.4 %Cys+Met (Translated Protein) 0.2 %Cys (Mature Protein) 1.2 %Met (Mature Protein) 1.4 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MYRKPTISFDRGTLILHPPPQGKTWIDYATWDDRVEKFRVRAIDYRPLVELLKAEKIDFI CCCCCCCEECCCEEEECCCCCCCEEEEECCHHHHHHHHHHEEECHHHHHHHHHHHCCHHH DKAKEFAPLELIPSFEMLPYPHQEAALKAWKQNNRNGVVILPTASGKTYLAQLAMQATPR HHHHHCCCCEECCCCCCCCCCCHHHHHHHHHHCCCCCEEEEECCCCHHHHHHHHHHCCCC STLVVVPTLDLMHQWYAHLNAAFPDVEVGLLGGGSRDKTPILVATYDSATIHAETIGNKY CEEEEECCHHHHHHHHHHHCCCCCCCEEEEECCCCCCCCCEEEEECCCCEEEEEECCCEE ALLVFDECHHLPTDFYRVIAEYAISPYRLGLTATPNRSDGRHSDLNYLIGPTVFSKTPEE EEEEECCCCCCCHHHHHHHHHHCCCCEEEEEEECCCCCCCCCCCCCEEECCHHHCCCHHH LAGSALADHKIVQIMVKLSPQEREEYNKLMIIRNDFLTQANIKLGGVNGWKNFVIASARS HHCCHHHHHHEEEHEECCCCHHHHCCCEEEEEECCCEEECCEEEECCCCCCCEEEEECCC TAGRRAMLAHRQAKEIALGTEGKLRTLSNLLVQHFPERTLIFTADNTTVYRISHDFLIPA CCCHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHCCCCEEEEEECCCEEEEEECCEEEEE ITHQTPVKERHEVLSKFRTGEYKTIVASHVLNEGVDVPDARVAVILSGTGSEREYIQRLG CCCCCCHHHHHHHHHHHCCCCHHHHHHHHHHHCCCCCCCCEEEEEEECCCCHHHHHHHHH RVLRRGSDKNKLAILYEVVTENTTEEQTSRRRRAGIKRKKSHQDQDEKQENSVVQQLEII HHHHCCCCCCCEEEEEEEHHCCCCHHHHHHHHHHCCHHHHCCCCHHHHHHHHHHHHHHHC KPEPNYEINNPAAQAVAEPGVKWDYEKENDVKTPEDNLPNQKFAKSQEQDQEKTELQPLE CCCCCCCCCCHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHCCHHH NIQPEPIYRINNSTTKLAAEPGKKYKEYGKDNPEEESVKSQEQEQEKTEL CCCCCCEEEECCCCEEEECCCCHHHHHHCCCCCHHHHHHHHHHHHHHHCC >Mature Secondary Structure MYRKPTISFDRGTLILHPPPQGKTWIDYATWDDRVEKFRVRAIDYRPLVELLKAEKIDFI CCCCCCCEECCCEEEECCCCCCCEEEEECCHHHHHHHHHHEEECHHHHHHHHHHHCCHHH DKAKEFAPLELIPSFEMLPYPHQEAALKAWKQNNRNGVVILPTASGKTYLAQLAMQATPR HHHHHCCCCEECCCCCCCCCCCHHHHHHHHHHCCCCCEEEEECCCCHHHHHHHHHHCCCC STLVVVPTLDLMHQWYAHLNAAFPDVEVGLLGGGSRDKTPILVATYDSATIHAETIGNKY CEEEEECCHHHHHHHHHHHCCCCCCCEEEEECCCCCCCCCEEEEECCCCEEEEEECCCEE ALLVFDECHHLPTDFYRVIAEYAISPYRLGLTATPNRSDGRHSDLNYLIGPTVFSKTPEE EEEEECCCCCCCHHHHHHHHHHCCCCEEEEEEECCCCCCCCCCCCCEEECCHHHCCCHHH LAGSALADHKIVQIMVKLSPQEREEYNKLMIIRNDFLTQANIKLGGVNGWKNFVIASARS HHCCHHHHHHEEEHEECCCCHHHHCCCEEEEEECCCEEECCEEEECCCCCCCEEEEECCC TAGRRAMLAHRQAKEIALGTEGKLRTLSNLLVQHFPERTLIFTADNTTVYRISHDFLIPA CCCHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHCCCCEEEEEECCCEEEEEECCEEEEE ITHQTPVKERHEVLSKFRTGEYKTIVASHVLNEGVDVPDARVAVILSGTGSEREYIQRLG CCCCCCHHHHHHHHHHHCCCCHHHHHHHHHHHCCCCCCCCEEEEEEECCCCHHHHHHHHH RVLRRGSDKNKLAILYEVVTENTTEEQTSRRRRAGIKRKKSHQDQDEKQENSVVQQLEII HHHHCCCCCCCEEEEEEEHHCCCCHHHHHHHHHHCCHHHHCCCCHHHHHHHHHHHHHHHC KPEPNYEINNPAAQAVAEPGVKWDYEKENDVKTPEDNLPNQKFAKSQEQDQEKTELQPLE CCCCCCCCCCHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHCCHHH NIQPEPIYRINNSTTKLAAEPGKKYKEYGKDNPEEESVKSQEQEQEKTEL CCCCCCEEEECCCCEEEECCCCHHHHHHCCCCCHHHHHHHHHHHHHHHCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: NA