| Definition | Thermococcus onnurineus NA1, complete genome. |
|---|---|
| Accession | NC_011529 |
| Length | 1,847,607 |
Click here to switch to the map view.
The map label for this gene is wcaL [C]
Identifier: 212224471
GI number: 212224471
Start: 1198545
End: 1199687
Strand: Reverse
Name: wcaL [C]
Synonym: TON_1320
Alternate gene names: 212224471
Gene position: 1199687-1198545 (Counterclockwise)
Preceding gene: 212224472
Following gene: 212224470
Centisome position: 64.93
GC content: 53.72
Gene sequence:
>1143_bases ATGAAGATCGCCCTCGTCAGTGACTGGTACTACCCCAAGGTCGGCGGCGTCGCCAGCCACATGCACCACCTTGCAATTCA CCTCGGAGAGCGCGGTCATGAAGTGGCCATTGTTACCAACGATCTCGAGACCGGGAAGGAGGAGGAACTCGAAAGCCTTG GCATCGAACTCGTTAAGGTTCCGGGGAGGGTAAGCCCTATACTTGGGATCAACATGAGCTACTCCCTCGCATCGAGTGAA GGGCTGGGTGAATTTTTGGAGGATTACGATGTCGTGCACTCCCACCACGCCTTTACACCCCTTGCGCTCAAGGCTGTTAA AGCCGGTAGAACCCTCGGGAAGGCGACCCTGCTGACAACCCACAGCATATCTTTCTCCTACGAATCGCGGCTCTGGGAAG CTCTCGGACTGACTATCCCTCTCTTTAGCAGATATCTCCGCTATCCCCACGAAATAATAGCTGTCAGCAAGGCTGCAGAG GCGTTCATCAACCACTTCACGGATGTTCCTGTGAGGGTCATCCCGAACGGGGTAGACGATGAGATCTTCAAACCCTTGAG TAATAAGGAAAGAGACCGCCTCAAGTCAGAACTCGGTATTGAGGGAAAGGTTGTCCTGTATGTCAGCAGGATGAGCTACC GCAAGGGACCTCAAGTTCTCATCAATGCCTTCTCGAAGATAGAGGACGCGACACTCATCTTGGTTGGCTCGGGTGAGATG CTTCCCTTCCTGAAGGCGCAGGCTAAGTTCCTGAAGATGGAGGACAGGGTGCGCTTCCTTGGCTATGTGGAGAGCTCTCT CCTTCCGAAGCTCTTCGGCATGGCGGATGTCTTTGTCCTTCCATCCATTACGGCGGAGGCTTTCGGTATAGTAATTCTCG AAGCGATGGCGTCGGGCATCCCCGTTGTCGCGACGGACGTTGGGGGAATCCCCGAGATAATTAAGGAGAGTAGAAGTGGA CTCCTCGTTCCACCAGGCAACGAGCTTTCGCTTAGGGATGCAATTCAAAAGCTCCTCAACGACGAGGAACTCGCGAAGTG GTTCGGAAGCAACGGAAGGAAAGCTGTGGAGGAGCGTTACTCGTGGAAAAAGGTCGCTGCAGAGATAGAAAAGGCTTATG AGGATGCACTCCTTATGGGGTAA
Upstream 100 bases:
>100_bases ACTGGGAGTGGCCGTTTACGGGTTCAAGGACAACTACAGGCTCATGGATGCTGGAGTGGTCGCTTTGCTCATCACACACC TGCTCGGGACGGTGGTGTGA
Downstream 100 bases:
>100_bases GGGGATAATTATGAGGATGGAAGAACTCACCTGGCCTGATTTTGAGGAAGCTAAGAAATCAATAGATACGGTTCTTATTC CCGTTGGGAGTGTGGAAGCC
Product: glycosyltransferase
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 380; Mature: 380
Protein sequence:
>380_residues MKIALVSDWYYPKVGGVASHMHHLAIHLGERGHEVAIVTNDLETGKEEELESLGIELVKVPGRVSPILGINMSYSLASSE GLGEFLEDYDVVHSHHAFTPLALKAVKAGRTLGKATLLTTHSISFSYESRLWEALGLTIPLFSRYLRYPHEIIAVSKAAE AFINHFTDVPVRVIPNGVDDEIFKPLSNKERDRLKSELGIEGKVVLYVSRMSYRKGPQVLINAFSKIEDATLILVGSGEM LPFLKAQAKFLKMEDRVRFLGYVESSLLPKLFGMADVFVLPSITAEAFGIVILEAMASGIPVVATDVGGIPEIIKESRSG LLVPPGNELSLRDAIQKLLNDEELAKWFGSNGRKAVEERYSWKKVAAEIEKAYEDALLMG
Sequences:
>Translated_380_residues MKIALVSDWYYPKVGGVASHMHHLAIHLGERGHEVAIVTNDLETGKEEELESLGIELVKVPGRVSPILGINMSYSLASSE GLGEFLEDYDVVHSHHAFTPLALKAVKAGRTLGKATLLTTHSISFSYESRLWEALGLTIPLFSRYLRYPHEIIAVSKAAE AFINHFTDVPVRVIPNGVDDEIFKPLSNKERDRLKSELGIEGKVVLYVSRMSYRKGPQVLINAFSKIEDATLILVGSGEM LPFLKAQAKFLKMEDRVRFLGYVESSLLPKLFGMADVFVLPSITAEAFGIVILEAMASGIPVVATDVGGIPEIIKESRSG LLVPPGNELSLRDAIQKLLNDEELAKWFGSNGRKAVEERYSWKKVAAEIEKAYEDALLMG >Mature_380_residues MKIALVSDWYYPKVGGVASHMHHLAIHLGERGHEVAIVTNDLETGKEEELESLGIELVKVPGRVSPILGINMSYSLASSE GLGEFLEDYDVVHSHHAFTPLALKAVKAGRTLGKATLLTTHSISFSYESRLWEALGLTIPLFSRYLRYPHEIIAVSKAAE AFINHFTDVPVRVIPNGVDDEIFKPLSNKERDRLKSELGIEGKVVLYVSRMSYRKGPQVLINAFSKIEDATLILVGSGEM LPFLKAQAKFLKMEDRVRFLGYVESSLLPKLFGMADVFVLPSITAEAFGIVILEAMASGIPVVATDVGGIPEIIKESRSG LLVPPGNELSLRDAIQKLLNDEELAKWFGSNGRKAVEERYSWKKVAAEIEKAYEDALLMG
Specific function: Slime polysaccharide colanic acid biosynthesis. [C]
COG id: COG0438
COG function: function code M; Glycosyltransferase
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the glycosyltransferase 1 family [H]
Homologues:
Organism=Homo sapiens, GI11863130, Length=386, Percent_Identity=30.8290155440415, Blast_Score=139, Evalue=5e-33, Organism=Homo sapiens, GI299782546, Length=152, Percent_Identity=32.8947368421053, Blast_Score=67, Evalue=3e-11, Organism=Escherichia coli, GI1788357, Length=132, Percent_Identity=32.5757575757576, Blast_Score=69, Evalue=7e-13, Organism=Caenorhabditis elegans, GI17532709, Length=387, Percent_Identity=27.906976744186, Blast_Score=118, Evalue=5e-27, Organism=Saccharomyces cerevisiae, GI9755344, Length=397, Percent_Identity=24.9370277078086, Blast_Score=112, Evalue=1e-25, Organism=Drosophila melanogaster, GI24654571, Length=325, Percent_Identity=29.5384615384615, Blast_Score=114, Evalue=8e-26,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR001296 - InterPro: IPR013534 [H]
Pfam domain/function: PF08323 Glyco_transf_5; PF00534 Glycos_transf_1 [H]
EC number: 2.-.-.- [C]
Molecular weight: Translated: 41917; Mature: 41917
Theoretical pI: Translated: 6.15; Mature: 6.15
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.0 %Cys (Translated Protein) 2.4 %Met (Translated Protein) 2.4 %Cys+Met (Translated Protein) 0.0 %Cys (Mature Protein) 2.4 %Met (Mature Protein) 2.4 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MKIALVSDWYYPKVGGVASHMHHLAIHLGERGHEVAIVTNDLETGKEEELESLGIELVKV CEEEEECCCCCCCCCHHHHHHHHHHHHCCCCCCEEEEEECCCCCCCHHHHHHCCCEEEEC PGRVSPILGINMSYSLASSEGLGEFLEDYDVVHSHHAFTPLALKAVKAGRTLGKATLLTT CCCCCCEEECCCEEECCCCCCHHHHHHHHHHHHCCCCCCHHHHHHHHHCCHHCCEEEEEE HSISFSYESRLWEALGLTIPLFSRYLRYPHEIIAVSKAAEAFINHFTDVPVRVIPNGVDD EEECCHHHHHHHHHHCCHHHHHHHHHHCCHHHHHHHHHHHHHHHHHCCCCEEECCCCCCH EIFKPLSNKERDRLKSELGIEGKVVLYVSRMSYRKGPQVLINAFSKIEDATLILVGSGEM HHHCCCCCHHHHHHHHHHCCCCEEEEEEECCCCCCCHHHHHHHHHHCCCCEEEEEECCCC LPFLKAQAKFLKMEDRVRFLGYVESSLLPKLFGMADVFVLPSITAEAFGIVILEAMASGI CHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHCCC PVVATDVGGIPEIIKESRSGLLVPPGNELSLRDAIQKLLNDEELAKWFGSNGRKAVEERY CEEEECCCCCHHHHHHCCCCEEECCCCCCCHHHHHHHHHCHHHHHHHHCCCCHHHHHHHH SWKKVAAEIEKAYEDALLMG HHHHHHHHHHHHHHHHHCCC >Mature Secondary Structure MKIALVSDWYYPKVGGVASHMHHLAIHLGERGHEVAIVTNDLETGKEEELESLGIELVKV CEEEEECCCCCCCCCHHHHHHHHHHHHCCCCCCEEEEEECCCCCCCHHHHHHCCCEEEEC PGRVSPILGINMSYSLASSEGLGEFLEDYDVVHSHHAFTPLALKAVKAGRTLGKATLLTT CCCCCCEEECCCEEECCCCCCHHHHHHHHHHHHCCCCCCHHHHHHHHHCCHHCCEEEEEE HSISFSYESRLWEALGLTIPLFSRYLRYPHEIIAVSKAAEAFINHFTDVPVRVIPNGVDD EEECCHHHHHHHHHHCCHHHHHHHHHHCCHHHHHHHHHHHHHHHHHCCCCEEECCCCCCH EIFKPLSNKERDRLKSELGIEGKVVLYVSRMSYRKGPQVLINAFSKIEDATLILVGSGEM HHHCCCCCHHHHHHHHHHCCCCEEEEEEECCCCCCCHHHHHHHHHHCCCCEEEEEECCCC LPFLKAQAKFLKMEDRVRFLGYVESSLLPKLFGMADVFVLPSITAEAFGIVILEAMASGI CHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHCCC PVVATDVGGIPEIIKESRSGLLVPPGNELSLRDAIQKLLNDEELAKWFGSNGRKAVEERY CEEEECCCCCHHHHHHCCCCEEECCCCCCCHHHHHHHHHCHHHHHHHHCCCCHHHHHHHH SWKKVAAEIEKAYEDALLMG HHHHHHHHHHHHHHHHHCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 8688087 [H]