| Definition | Vibrio cholerae M66-2 chromosome I, complete genome. |
|---|---|
| Accession | NC_012578 |
| Length | 2,892,523 |
Click here to switch to the map view.
The map label for this gene is tas [H]
Identifier: 227080848
GI number: 227080848
Start: 672044
End: 673102
Strand: Reverse
Name: tas [H]
Synonym: VCM66_0625
Alternate gene names: 227080848
Gene position: 673102-672044 (Counterclockwise)
Preceding gene: 227080849
Following gene: 227080842
Centisome position: 23.27
GC content: 47.31
Gene sequence:
>1059_bases TTGGCTCTAAGACAAGGAAGTGCTATGCAATATACCAAGCTGCCTCATTCCAGCCTCGAAATCAGCAAGATCTGTTTAGG TACCATGACTTTTGGTGAACAGAATTCGCAAGCTGATGCCTTTCAACAGCTCGATTATGCTCTCGAGCGTGGAGTGAATT TTATCGATACGGCGGAGATGTATCCGGTTCCGCCAACGGCACAAACCCAAGGTAAAACCGAAGAGTTTATTGGCAATTGG CTGGCTAAATCCGGTAAGCGAGAGAAAATCGTGCTCGCCACCAAAGTCGCTGGTCCACGCAATGTGCCTTACATTCGCGA CAAAATGGCGCTCGATCATCGCAATATCCATCAAGCGGTCGATGATAGCCTACGTCGTCTGCAAACGGATTATATCGACC TGTATCAACTTCACTGGCCGCAGCGCCAAACCAATACTTTCGGTCAGCTCAACTACCCTTATCCAGACAAGCAAGAAGAA GTAACGCTGATTGAAACACTGGAAGCGCTCAATGATTTGGTGCGCATGGGTAAAGTGCGTTATATCGGAGTCTCTAATGA AACGCCGTGGGGAGTGATGAGCTACCTGCGTCTTGCAGAAAAGCATGAACTGCCAAGAATTGTCTCGATCCAGAATCCTT ATAATCTGCTCAACCGCAGTTTTGAGGTGGGACTTGCCGAAATAAGTCATCTGGAGGGCGTTAAGCTACTCGCTTACTCG CCACTCGCCTTTGGTGCTTTAAGTGGTAAATATCTCAATGGTGCTCGTCCTGCGGGTGCGCGTTGTACACTGCATCAACG CTTCTCACGCTACTTTACAGAACAAGGCATTCTTGCAACAGAAGCCTATGTCGCATTAGCCCAGCAATTTGGGCTCGATC CTGCGCAAATGGCACTGGCGTTTGTTAATCAGCGCCCATTTGTGGCCTCGAATATTATCGGAGCCACAACGATGGAGCAG TTAAAATCGAATTTGGATAGTTTGGATATTTCATTAAATGCAGAACTTCTGCAAAAAATTCAGGAGATTGGAACCACTTA TTCCAATCCCTGTCCTTAG
Upstream 100 bases:
>100_bases CGACAGCGCAAACCTCTGTGATTTTTCTTATTTCGAATGTAACGAAGTCGCCACCATCACTCGGCTTCAACTTCCAATAC AAGGGAATATCATTCGTTCT
Downstream 100 bases:
>100_bases TGATGTGGGGGCTGGTGCACAGACCAGCCCCTTAGCATTACGTCGGTATTCGCGCAGCTAACACTCGACGAATATGTCTC ACACGGCGTTCCGCGACAAC
Product: oxidoreductase Tas, aldo/keto reductase family
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 352; Mature: 351
Protein sequence:
>352_residues MALRQGSAMQYTKLPHSSLEISKICLGTMTFGEQNSQADAFQQLDYALERGVNFIDTAEMYPVPPTAQTQGKTEEFIGNW LAKSGKREKIVLATKVAGPRNVPYIRDKMALDHRNIHQAVDDSLRRLQTDYIDLYQLHWPQRQTNTFGQLNYPYPDKQEE VTLIETLEALNDLVRMGKVRYIGVSNETPWGVMSYLRLAEKHELPRIVSIQNPYNLLNRSFEVGLAEISHLEGVKLLAYS PLAFGALSGKYLNGARPAGARCTLHQRFSRYFTEQGILATEAYVALAQQFGLDPAQMALAFVNQRPFVASNIIGATTMEQ LKSNLDSLDISLNAELLQKIQEIGTTYSNPCP
Sequences:
>Translated_352_residues MALRQGSAMQYTKLPHSSLEISKICLGTMTFGEQNSQADAFQQLDYALERGVNFIDTAEMYPVPPTAQTQGKTEEFIGNW LAKSGKREKIVLATKVAGPRNVPYIRDKMALDHRNIHQAVDDSLRRLQTDYIDLYQLHWPQRQTNTFGQLNYPYPDKQEE VTLIETLEALNDLVRMGKVRYIGVSNETPWGVMSYLRLAEKHELPRIVSIQNPYNLLNRSFEVGLAEISHLEGVKLLAYS PLAFGALSGKYLNGARPAGARCTLHQRFSRYFTEQGILATEAYVALAQQFGLDPAQMALAFVNQRPFVASNIIGATTMEQ LKSNLDSLDISLNAELLQKIQEIGTTYSNPCP >Mature_351_residues ALRQGSAMQYTKLPHSSLEISKICLGTMTFGEQNSQADAFQQLDYALERGVNFIDTAEMYPVPPTAQTQGKTEEFIGNWL AKSGKREKIVLATKVAGPRNVPYIRDKMALDHRNIHQAVDDSLRRLQTDYIDLYQLHWPQRQTNTFGQLNYPYPDKQEEV TLIETLEALNDLVRMGKVRYIGVSNETPWGVMSYLRLAEKHELPRIVSIQNPYNLLNRSFEVGLAEISHLEGVKLLAYSP LAFGALSGKYLNGARPAGARCTLHQRFSRYFTEQGILATEAYVALAQQFGLDPAQMALAFVNQRPFVASNIIGATTMEQL KSNLDSLDISLNAELLQKIQEIGTTYSNPCP
Specific function: Unknown
COG id: COG0667
COG function: function code C; Predicted oxidoreductases (related to aryl-alcohol dehydrogenases)
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the aldo/keto reductase 2 family [H]
Homologues:
Organism=Homo sapiens, GI27436969, Length=356, Percent_Identity=29.7752808988764, Blast_Score=117, Evalue=1e-26, Organism=Homo sapiens, GI27436962, Length=351, Percent_Identity=29.3447293447293, Blast_Score=116, Evalue=4e-26, Organism=Homo sapiens, GI27436964, Length=348, Percent_Identity=29.3103448275862, Blast_Score=115, Evalue=5e-26, Organism=Homo sapiens, GI4504825, Length=344, Percent_Identity=29.0697674418605, Blast_Score=115, Evalue=9e-26, Organism=Homo sapiens, GI27436966, Length=333, Percent_Identity=29.7297297297297, Blast_Score=112, Evalue=4e-25, Organism=Homo sapiens, GI27436971, Length=357, Percent_Identity=28.8515406162465, Blast_Score=103, Evalue=3e-22, Organism=Homo sapiens, GI223718702, Length=347, Percent_Identity=25.0720461095101, Blast_Score=75, Evalue=1e-13, Organism=Homo sapiens, GI41327764, Length=347, Percent_Identity=25.6484149855908, Blast_Score=70, Evalue=3e-12, Organism=Homo sapiens, GI41152114, Length=347, Percent_Identity=25.0720461095101, Blast_Score=69, Evalue=5e-12, Organism=Escherichia coli, GI1789199, Length=346, Percent_Identity=62.4277456647399, Blast_Score=456, Evalue=1e-130, Organism=Escherichia coli, GI87081735, Length=361, Percent_Identity=34.0720221606648, Blast_Score=165, Evalue=3e-42, Organism=Escherichia coli, GI1789375, Length=337, Percent_Identity=28.7833827893175, Blast_Score=107, Evalue=1e-24, Organism=Escherichia coli, GI1788070, Length=351, Percent_Identity=28.7749287749288, Blast_Score=98, Evalue=9e-22, Organism=Escherichia coli, GI1788081, Length=315, Percent_Identity=29.8412698412698, Blast_Score=84, Evalue=2e-17, Organism=Caenorhabditis elegans, GI17537077, Length=348, Percent_Identity=26.7241379310345, Blast_Score=68, Evalue=7e-12, Organism=Caenorhabditis elegans, GI17537075, Length=355, Percent_Identity=26.4788732394366, Blast_Score=67, Evalue=1e-11, Organism=Saccharomyces cerevisiae, GI6323998, Length=344, Percent_Identity=28.1976744186047, Blast_Score=119, Evalue=7e-28, Organism=Saccharomyces cerevisiae, GI6319958, Length=314, Percent_Identity=27.7070063694268, Blast_Score=113, Evalue=5e-26, Organism=Saccharomyces cerevisiae, GI6319951, Length=343, Percent_Identity=26.2390670553936, Blast_Score=102, Evalue=1e-22, Organism=Saccharomyces cerevisiae, GI6322615, Length=236, Percent_Identity=27.1186440677966, Blast_Score=90, Evalue=5e-19, Organism=Saccharomyces cerevisiae, GI6325169, Length=260, Percent_Identity=28.4615384615385, Blast_Score=85, Evalue=2e-17, Organism=Saccharomyces cerevisiae, GI6321052, Length=139, Percent_Identity=33.8129496402878, Blast_Score=75, Evalue=1e-14, Organism=Saccharomyces cerevisiae, GI6324694, Length=178, Percent_Identity=30.3370786516854, Blast_Score=69, Evalue=2e-12, Organism=Drosophila melanogaster, GI45553081, Length=329, Percent_Identity=27.355623100304, Blast_Score=77, Evalue=1e-14, Organism=Drosophila melanogaster, GI24646159, Length=348, Percent_Identity=27.0114942528736, Blast_Score=72, Evalue=5e-13, Organism=Drosophila melanogaster, GI24646155, Length=341, Percent_Identity=25.2199413489736, Blast_Score=69, Evalue=5e-12,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR001395 - InterPro: IPR020471 - InterPro: IPR023210 [H]
Pfam domain/function: PF00248 Aldo_ket_red [H]
EC number: NA
Molecular weight: Translated: 39550; Mature: 39418
Theoretical pI: Translated: 6.88; Mature: 6.88
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.9 %Cys (Translated Protein) 2.6 %Met (Translated Protein) 3.4 %Cys+Met (Translated Protein) 0.9 %Cys (Mature Protein) 2.3 %Met (Mature Protein) 3.1 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MALRQGSAMQYTKLPHSSLEISKICLGTMTFGEQNSQADAFQQLDYALERGVNFIDTAEM CCCCCCCCCEECCCCCCCCHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHCCCEEECCCC YPVPPTAQTQGKTEEFIGNWLAKSGKREKIVLATKVAGPRNVPYIRDKMALDHRNIHQAV CCCCCCCCCCCCHHHHHHHHHHCCCCCCEEEEEEECCCCCCCCCHHHHHHHHHHHHHHHH DDSLRRLQTDYIDLYQLHWPQRQTNTFGQLNYPYPDKQEEVTLIETLEALNDLVRMGKVR HHHHHHHHHHHHHHHHHCCCCHHCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHCCEE YIGVSNETPWGVMSYLRLAEKHELPRIVSIQNPYNLLNRSFEVGLAEISHLEGVKLLAYS EEECCCCCCHHHHHHHHHHHHHCCCCEEEECCCHHHHHHHHHHHHHHHHHHCCCEEEEEC PLAFGALSGKYLNGARPAGARCTLHQRFSRYFTEQGILATEAYVALAQQFGLDPAQMALA CHHHHCCCCCCCCCCCCCCCCHHHHHHHHHHHHHCCCHHHHHHHHHHHHHCCCHHHHHHH FVNQRPFVASNIIGATTMEQLKSNLDSLDISLNAELLQKIQEIGTTYSNPCP HHCCCCCHHHHHHHHHHHHHHHHCCCCEEEEECHHHHHHHHHHCCCCCCCCC >Mature Secondary Structure ALRQGSAMQYTKLPHSSLEISKICLGTMTFGEQNSQADAFQQLDYALERGVNFIDTAEM CCCCCCCCEECCCCCCCCHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHCCCEEECCCC YPVPPTAQTQGKTEEFIGNWLAKSGKREKIVLATKVAGPRNVPYIRDKMALDHRNIHQAV CCCCCCCCCCCCHHHHHHHHHHCCCCCCEEEEEEECCCCCCCCCHHHHHHHHHHHHHHHH DDSLRRLQTDYIDLYQLHWPQRQTNTFGQLNYPYPDKQEEVTLIETLEALNDLVRMGKVR HHHHHHHHHHHHHHHHHCCCCHHCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHCCEE YIGVSNETPWGVMSYLRLAEKHELPRIVSIQNPYNLLNRSFEVGLAEISHLEGVKLLAYS EEECCCCCCHHHHHHHHHHHHHCCCCEEEECCCHHHHHHHHHHHHHHHHHHCCCEEEEEC PLAFGALSGKYLNGARPAGARCTLHQRFSRYFTEQGILATEAYVALAQQFGLDPAQMALA CHHHHCCCCCCCCCCCCCCCCHHHHHHHHHHHHHCCCHHHHHHHHHHHHHCCCHHHHHHH FVNQRPFVASNIIGATTMEQLKSNLDSLDISLNAELLQKIQEIGTTYSNPCP HHCCCCCHHHHHHHHHHHHHHHHCCCCEEEEECHHHHHHHHHHCCCCCCCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 10.0
TargetDB status: NA
Availability: NA
References: 9560382; 9278503 [H]