| Definition | Candidatus Phytoplasma australiense, complete genome. |
|---|---|
| Accession | NC_010544 |
| Length | 879,959 |
Click here to switch to the map view.
The map label for this gene is engD [H]
Identifier: 197294429
GI number: 197294429
Start: 362033
End: 363124
Strand: Reverse
Name: engD [H]
Synonym: PAa_0347
Alternate gene names: 197294429
Gene position: 363124-362033 (Counterclockwise)
Preceding gene: 197294430
Following gene: 197294428
Centisome position: 41.27
GC content: 27.93
Gene sequence:
>1092_bases ATGAAAATAGGTATTATTGGTTTACCGAATGTGGGTAAATCAACTTTATTTAATGCTTTAACGAAAATGCAAGTTTTAGA AGCTAACTATCCTTTTGCAACAATTGAACCTAACGTAGGAACAGTTGAGGTCCCTGACCCACGTTTAAAAAAATTATCCC AAATTTTTCAATCTCAAAAAATAATTTCTGCTTTAATAGAATTTAAAGATATTGCAGGATTAGTAGCAGGTGCTTCTAAA GGAGAAGGATTAGGAAATCAATTTTTAAGTCATATTCGCAATGTAGATGCTATTTGTCATGTTGTTAAATGTTTTGAAGA CCCTAATATTTTGCATGTTATGGACAAAAATGACCCTTTAGAAGAAATTAAAATTATCGAAACCGAACTTGCTTTAGCAG ATTTAGAACAAATTGAAAAACGTTTACAAAAACTTCAAAAACAAAAAAAGAAAGGCGATAAAGATTTATTAAAAGAATAT AACGTTTTAACGAAAATTCAACATCATTTAACAAACGAAGATTTAAAAAACCTTTCTTTAAACGAAGAAGAATTAAAAAT AGTGAAAAACTTTAATTTATTATTTTTAAAACCTTCACTATATCTGGCTAATATCAAAGAAAATGATTTAGTAAACAACA AAAACTTGCTTTTACAAAAAGTATTGGATTATGGAAAACAAAAAGGCAAAAAAGTGATTTCTTTATGTGTCCAATTAGAA AAAGATTTATCTTTTTTGGAAGAAGAAGAAGAAGAAAAAGTTTTTTTAAAAGATTATGGGATGACTCAAACAGCTTTTGC AAAATTAATTCAAGAAAGCTACAATCTTTTAGGTTTACAAACTTATTTTACTGCAGGTCCTAAAGAAGTGCACGCTTGGT CTTTCCAAAAAGGATTAAAAGCTCCTGAATGTGCAAGAATTATTCACACCGATTTAGAAAAAGGGTTTATTAAAGCCGAA GTACTTGCATATGAAGATTTAATCACTCATCAAACTTTTCAAAAAAGCAAAGAAAAAGGAAAATTAAGAATCGAAGGTAA GGAATATATAGTAAAAGATGGCGATATTATTACTTTTAGGTTTAATGTATAA
Upstream 100 bases:
>100_bases AGTTTTCAAATTTTGGTAGAAAAAAATAATCTGATAATTATTAAATTTTTAAAAGCAATAAATTACTATAAATAGATTTA ATAGAAGGAATTTAAAAATT
Downstream 100 bases:
>100_bases AAAATAAAATAATTCAAATTCCAAGAAAGAAATAAAATTATGCAAAATTATAAAAAGACTCTTTTAATGCCTCAAACTGA TTTTCCGATGAAAGGAAATT
Product: GTP-dependent nucleic acid-binding protein EngD
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 363; Mature: 363
Protein sequence:
>363_residues MKIGIIGLPNVGKSTLFNALTKMQVLEANYPFATIEPNVGTVEVPDPRLKKLSQIFQSQKIISALIEFKDIAGLVAGASK GEGLGNQFLSHIRNVDAICHVVKCFEDPNILHVMDKNDPLEEIKIIETELALADLEQIEKRLQKLQKQKKKGDKDLLKEY NVLTKIQHHLTNEDLKNLSLNEEELKIVKNFNLLFLKPSLYLANIKENDLVNNKNLLLQKVLDYGKQKGKKVISLCVQLE KDLSFLEEEEEEKVFLKDYGMTQTAFAKLIQESYNLLGLQTYFTAGPKEVHAWSFQKGLKAPECARIIHTDLEKGFIKAE VLAYEDLITHQTFQKSKEKGKLRIEGKEYIVKDGDIITFRFNV
Sequences:
>Translated_363_residues MKIGIIGLPNVGKSTLFNALTKMQVLEANYPFATIEPNVGTVEVPDPRLKKLSQIFQSQKIISALIEFKDIAGLVAGASK GEGLGNQFLSHIRNVDAICHVVKCFEDPNILHVMDKNDPLEEIKIIETELALADLEQIEKRLQKLQKQKKKGDKDLLKEY NVLTKIQHHLTNEDLKNLSLNEEELKIVKNFNLLFLKPSLYLANIKENDLVNNKNLLLQKVLDYGKQKGKKVISLCVQLE KDLSFLEEEEEEKVFLKDYGMTQTAFAKLIQESYNLLGLQTYFTAGPKEVHAWSFQKGLKAPECARIIHTDLEKGFIKAE VLAYEDLITHQTFQKSKEKGKLRIEGKEYIVKDGDIITFRFNV >Mature_363_residues MKIGIIGLPNVGKSTLFNALTKMQVLEANYPFATIEPNVGTVEVPDPRLKKLSQIFQSQKIISALIEFKDIAGLVAGASK GEGLGNQFLSHIRNVDAICHVVKCFEDPNILHVMDKNDPLEEIKIIETELALADLEQIEKRLQKLQKQKKKGDKDLLKEY NVLTKIQHHLTNEDLKNLSLNEEELKIVKNFNLLFLKPSLYLANIKENDLVNNKNLLLQKVLDYGKQKGKKVISLCVQLE KDLSFLEEEEEEKVFLKDYGMTQTAFAKLIQESYNLLGLQTYFTAGPKEVHAWSFQKGLKAPECARIIHTDLEKGFIKAE VLAYEDLITHQTFQKSKEKGKLRIEGKEYIVKDGDIITFRFNV
Specific function: GTP-dependent nucleic acid-binding protein which may act as a translation factor [H]
COG id: COG0012
COG function: function code J; Predicted GTPase, probable translation factor
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 1 G (guanine nucleotide-binding) domain [H]
Homologues:
Organism=Homo sapiens, GI58761500, Length=369, Percent_Identity=43.360433604336, Blast_Score=284, Evalue=1e-76, Organism=Homo sapiens, GI58761502, Length=217, Percent_Identity=39.1705069124424, Blast_Score=147, Evalue=1e-35, Organism=Escherichia coli, GI1787454, Length=364, Percent_Identity=49.7252747252747, Blast_Score=371, Evalue=1e-104, Organism=Escherichia coli, GI1789574, Length=128, Percent_Identity=32.8125, Blast_Score=74, Evalue=1e-14, Organism=Caenorhabditis elegans, GI17509631, Length=367, Percent_Identity=40.3269754768392, Blast_Score=258, Evalue=4e-69, Organism=Caenorhabditis elegans, GI17552324, Length=139, Percent_Identity=33.0935251798561, Blast_Score=65, Evalue=6e-11, Organism=Saccharomyces cerevisiae, GI6319499, Length=370, Percent_Identity=41.0810810810811, Blast_Score=261, Evalue=1e-70, Organism=Saccharomyces cerevisiae, GI6321773, Length=379, Percent_Identity=35.0923482849604, Blast_Score=211, Evalue=1e-55, Organism=Saccharomyces cerevisiae, GI6321649, Length=159, Percent_Identity=35.8490566037736, Blast_Score=82, Evalue=2e-16, Organism=Drosophila melanogaster, GI24640873, Length=368, Percent_Identity=40.4891304347826, Blast_Score=273, Evalue=1e-73, Organism=Drosophila melanogaster, GI24640877, Length=368, Percent_Identity=40.4891304347826, Blast_Score=273, Evalue=1e-73, Organism=Drosophila melanogaster, GI24640875, Length=368, Percent_Identity=40.4891304347826, Blast_Score=273, Evalue=1e-73, Organism=Drosophila melanogaster, GI24640879, Length=327, Percent_Identity=38.8379204892966, Blast_Score=223, Evalue=2e-58, Organism=Drosophila melanogaster, GI24585318, Length=196, Percent_Identity=31.1224489795918, Blast_Score=71, Evalue=1e-12,
Paralogues:
None
Copy number: 120 Molecules/Cell In: Growth Phase, Minimal Media (Based on E. coli). 140 Molecules/Cell In: Growth Phase, Minimal Media (Based on E. coli). [C]
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR012675 - InterPro: IPR004396 - InterPro: IPR013029 - InterPro: IPR006073 - InterPro: IPR002917 - InterPro: IPR012676 - InterPro: IPR023192 [H]
Pfam domain/function: PF01926 MMR_HSR1; PF06071 YchF-GTPase_C [H]
EC number: NA
Molecular weight: Translated: 41355; Mature: 41355
Theoretical pI: Translated: 7.60; Mature: 7.60
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.1 %Cys (Translated Protein) 1.1 %Met (Translated Protein) 2.2 %Cys+Met (Translated Protein) 1.1 %Cys (Mature Protein) 1.1 %Met (Mature Protein) 2.2 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MKIGIIGLPNVGKSTLFNALTKMQVLEANYPFATIEPNVGTVEVPDPRLKKLSQIFQSQK CEEEEEECCCCCHHHHHHHHHHHHHHCCCCCEEEECCCCCEEECCCHHHHHHHHHHHHHH IISALIEFKDIAGLVAGASKGEGLGNQFLSHIRNVDAICHVVKCFEDPNILHVMDKNDPL HHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCEEEEECCCCCH EEIKIIETELALADLEQIEKRLQKLQKQKKKGDKDLLKEYNVLTKIQHHLTNEDLKNLSL HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHCHHHHHCCCC NEEELKIVKNFNLLFLKPSLYLANIKENDLVNNKNLLLQKVLDYGKQKGKKVISLCVQLE CHHHHHHHHCCCEEEEECCEEEECCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHH KDLSFLEEEEEEKVFLKDYGMTQTAFAKLIQESYNLLGLQTYFTAGPKEVHAWSFQKGLK HHHHHHHCHHHCEEEHHHCCCCHHHHHHHHHHHHHHEEEHHHHCCCCHHHHHHHHHHCCC APECARIIHTDLEKGFIKAEVLAYEDLITHQTFQKSKEKGKLRIEGKEYIVKDGDIITFR CCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCEEECCCEEEEECCCEEEEE FNV ECC >Mature Secondary Structure MKIGIIGLPNVGKSTLFNALTKMQVLEANYPFATIEPNVGTVEVPDPRLKKLSQIFQSQK CEEEEEECCCCCHHHHHHHHHHHHHHCCCCCEEEECCCCCEEECCCHHHHHHHHHHHHHH IISALIEFKDIAGLVAGASKGEGLGNQFLSHIRNVDAICHVVKCFEDPNILHVMDKNDPL HHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCEEEEECCCCCH EEIKIIETELALADLEQIEKRLQKLQKQKKKGDKDLLKEYNVLTKIQHHLTNEDLKNLSL HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHCHHHHHCCCC NEEELKIVKNFNLLFLKPSLYLANIKENDLVNNKNLLLQKVLDYGKQKGKKVISLCVQLE CHHHHHHHHCCCEEEEECCEEEECCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHH KDLSFLEEEEEEKVFLKDYGMTQTAFAKLIQESYNLLGLQTYFTAGPKEVHAWSFQKGLK HHHHHHHCHHHCEEEHHHCCCCHHHHHHHHHHHHHHEEEHHHHCCCCHHHHHHHHHHCCC APECARIIHTDLEKGFIKAEVLAYEDLITHQTFQKSKEKGKLRIEGKEYIVKDGDIITFR CCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCEEECCCEEEEECCCEEEEE FNV ECC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 7584024; 9384377 [H]