Definition Vibrio cholerae M66-2 chromosome I, complete genome.
Accession NC_012578
Length 2,892,523

Click here to switch to the map view.

The map label for this gene is tas [H]

Identifier: 227080848

GI number: 227080848

Start: 672044

End: 673102

Strand: Reverse

Name: tas [H]

Synonym: VCM66_0625

Alternate gene names: 227080848

Gene position: 673102-672044 (Counterclockwise)

Preceding gene: 227080849

Following gene: 227080842

Centisome position: 23.27

GC content: 47.31

Gene sequence:

>1059_bases
TTGGCTCTAAGACAAGGAAGTGCTATGCAATATACCAAGCTGCCTCATTCCAGCCTCGAAATCAGCAAGATCTGTTTAGG
TACCATGACTTTTGGTGAACAGAATTCGCAAGCTGATGCCTTTCAACAGCTCGATTATGCTCTCGAGCGTGGAGTGAATT
TTATCGATACGGCGGAGATGTATCCGGTTCCGCCAACGGCACAAACCCAAGGTAAAACCGAAGAGTTTATTGGCAATTGG
CTGGCTAAATCCGGTAAGCGAGAGAAAATCGTGCTCGCCACCAAAGTCGCTGGTCCACGCAATGTGCCTTACATTCGCGA
CAAAATGGCGCTCGATCATCGCAATATCCATCAAGCGGTCGATGATAGCCTACGTCGTCTGCAAACGGATTATATCGACC
TGTATCAACTTCACTGGCCGCAGCGCCAAACCAATACTTTCGGTCAGCTCAACTACCCTTATCCAGACAAGCAAGAAGAA
GTAACGCTGATTGAAACACTGGAAGCGCTCAATGATTTGGTGCGCATGGGTAAAGTGCGTTATATCGGAGTCTCTAATGA
AACGCCGTGGGGAGTGATGAGCTACCTGCGTCTTGCAGAAAAGCATGAACTGCCAAGAATTGTCTCGATCCAGAATCCTT
ATAATCTGCTCAACCGCAGTTTTGAGGTGGGACTTGCCGAAATAAGTCATCTGGAGGGCGTTAAGCTACTCGCTTACTCG
CCACTCGCCTTTGGTGCTTTAAGTGGTAAATATCTCAATGGTGCTCGTCCTGCGGGTGCGCGTTGTACACTGCATCAACG
CTTCTCACGCTACTTTACAGAACAAGGCATTCTTGCAACAGAAGCCTATGTCGCATTAGCCCAGCAATTTGGGCTCGATC
CTGCGCAAATGGCACTGGCGTTTGTTAATCAGCGCCCATTTGTGGCCTCGAATATTATCGGAGCCACAACGATGGAGCAG
TTAAAATCGAATTTGGATAGTTTGGATATTTCATTAAATGCAGAACTTCTGCAAAAAATTCAGGAGATTGGAACCACTTA
TTCCAATCCCTGTCCTTAG

Upstream 100 bases:

>100_bases
CGACAGCGCAAACCTCTGTGATTTTTCTTATTTCGAATGTAACGAAGTCGCCACCATCACTCGGCTTCAACTTCCAATAC
AAGGGAATATCATTCGTTCT

Downstream 100 bases:

>100_bases
TGATGTGGGGGCTGGTGCACAGACCAGCCCCTTAGCATTACGTCGGTATTCGCGCAGCTAACACTCGACGAATATGTCTC
ACACGGCGTTCCGCGACAAC

Product: oxidoreductase Tas, aldo/keto reductase family

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 352; Mature: 351

Protein sequence:

>352_residues
MALRQGSAMQYTKLPHSSLEISKICLGTMTFGEQNSQADAFQQLDYALERGVNFIDTAEMYPVPPTAQTQGKTEEFIGNW
LAKSGKREKIVLATKVAGPRNVPYIRDKMALDHRNIHQAVDDSLRRLQTDYIDLYQLHWPQRQTNTFGQLNYPYPDKQEE
VTLIETLEALNDLVRMGKVRYIGVSNETPWGVMSYLRLAEKHELPRIVSIQNPYNLLNRSFEVGLAEISHLEGVKLLAYS
PLAFGALSGKYLNGARPAGARCTLHQRFSRYFTEQGILATEAYVALAQQFGLDPAQMALAFVNQRPFVASNIIGATTMEQ
LKSNLDSLDISLNAELLQKIQEIGTTYSNPCP

Sequences:

>Translated_352_residues
MALRQGSAMQYTKLPHSSLEISKICLGTMTFGEQNSQADAFQQLDYALERGVNFIDTAEMYPVPPTAQTQGKTEEFIGNW
LAKSGKREKIVLATKVAGPRNVPYIRDKMALDHRNIHQAVDDSLRRLQTDYIDLYQLHWPQRQTNTFGQLNYPYPDKQEE
VTLIETLEALNDLVRMGKVRYIGVSNETPWGVMSYLRLAEKHELPRIVSIQNPYNLLNRSFEVGLAEISHLEGVKLLAYS
PLAFGALSGKYLNGARPAGARCTLHQRFSRYFTEQGILATEAYVALAQQFGLDPAQMALAFVNQRPFVASNIIGATTMEQ
LKSNLDSLDISLNAELLQKIQEIGTTYSNPCP
>Mature_351_residues
ALRQGSAMQYTKLPHSSLEISKICLGTMTFGEQNSQADAFQQLDYALERGVNFIDTAEMYPVPPTAQTQGKTEEFIGNWL
AKSGKREKIVLATKVAGPRNVPYIRDKMALDHRNIHQAVDDSLRRLQTDYIDLYQLHWPQRQTNTFGQLNYPYPDKQEEV
TLIETLEALNDLVRMGKVRYIGVSNETPWGVMSYLRLAEKHELPRIVSIQNPYNLLNRSFEVGLAEISHLEGVKLLAYSP
LAFGALSGKYLNGARPAGARCTLHQRFSRYFTEQGILATEAYVALAQQFGLDPAQMALAFVNQRPFVASNIIGATTMEQL
KSNLDSLDISLNAELLQKIQEIGTTYSNPCP

Specific function: Unknown

COG id: COG0667

COG function: function code C; Predicted oxidoreductases (related to aryl-alcohol dehydrogenases)

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the aldo/keto reductase 2 family [H]

Homologues:

Organism=Homo sapiens, GI27436969, Length=356, Percent_Identity=29.7752808988764, Blast_Score=117, Evalue=1e-26,
Organism=Homo sapiens, GI27436962, Length=351, Percent_Identity=29.3447293447293, Blast_Score=116, Evalue=4e-26,
Organism=Homo sapiens, GI27436964, Length=348, Percent_Identity=29.3103448275862, Blast_Score=115, Evalue=5e-26,
Organism=Homo sapiens, GI4504825, Length=344, Percent_Identity=29.0697674418605, Blast_Score=115, Evalue=9e-26,
Organism=Homo sapiens, GI27436966, Length=333, Percent_Identity=29.7297297297297, Blast_Score=112, Evalue=4e-25,
Organism=Homo sapiens, GI27436971, Length=357, Percent_Identity=28.8515406162465, Blast_Score=103, Evalue=3e-22,
Organism=Homo sapiens, GI223718702, Length=347, Percent_Identity=25.0720461095101, Blast_Score=75, Evalue=1e-13,
Organism=Homo sapiens, GI41327764, Length=347, Percent_Identity=25.6484149855908, Blast_Score=70, Evalue=3e-12,
Organism=Homo sapiens, GI41152114, Length=347, Percent_Identity=25.0720461095101, Blast_Score=69, Evalue=5e-12,
Organism=Escherichia coli, GI1789199, Length=346, Percent_Identity=62.4277456647399, Blast_Score=456, Evalue=1e-130,
Organism=Escherichia coli, GI87081735, Length=361, Percent_Identity=34.0720221606648, Blast_Score=165, Evalue=3e-42,
Organism=Escherichia coli, GI1789375, Length=337, Percent_Identity=28.7833827893175, Blast_Score=107, Evalue=1e-24,
Organism=Escherichia coli, GI1788070, Length=351, Percent_Identity=28.7749287749288, Blast_Score=98, Evalue=9e-22,
Organism=Escherichia coli, GI1788081, Length=315, Percent_Identity=29.8412698412698, Blast_Score=84, Evalue=2e-17,
Organism=Caenorhabditis elegans, GI17537077, Length=348, Percent_Identity=26.7241379310345, Blast_Score=68, Evalue=7e-12,
Organism=Caenorhabditis elegans, GI17537075, Length=355, Percent_Identity=26.4788732394366, Blast_Score=67, Evalue=1e-11,
Organism=Saccharomyces cerevisiae, GI6323998, Length=344, Percent_Identity=28.1976744186047, Blast_Score=119, Evalue=7e-28,
Organism=Saccharomyces cerevisiae, GI6319958, Length=314, Percent_Identity=27.7070063694268, Blast_Score=113, Evalue=5e-26,
Organism=Saccharomyces cerevisiae, GI6319951, Length=343, Percent_Identity=26.2390670553936, Blast_Score=102, Evalue=1e-22,
Organism=Saccharomyces cerevisiae, GI6322615, Length=236, Percent_Identity=27.1186440677966, Blast_Score=90, Evalue=5e-19,
Organism=Saccharomyces cerevisiae, GI6325169, Length=260, Percent_Identity=28.4615384615385, Blast_Score=85, Evalue=2e-17,
Organism=Saccharomyces cerevisiae, GI6321052, Length=139, Percent_Identity=33.8129496402878, Blast_Score=75, Evalue=1e-14,
Organism=Saccharomyces cerevisiae, GI6324694, Length=178, Percent_Identity=30.3370786516854, Blast_Score=69, Evalue=2e-12,
Organism=Drosophila melanogaster, GI45553081, Length=329, Percent_Identity=27.355623100304, Blast_Score=77, Evalue=1e-14,
Organism=Drosophila melanogaster, GI24646159, Length=348, Percent_Identity=27.0114942528736, Blast_Score=72, Evalue=5e-13,
Organism=Drosophila melanogaster, GI24646155, Length=341, Percent_Identity=25.2199413489736, Blast_Score=69, Evalue=5e-12,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR001395
- InterPro:   IPR020471
- InterPro:   IPR023210 [H]

Pfam domain/function: PF00248 Aldo_ket_red [H]

EC number: NA

Molecular weight: Translated: 39550; Mature: 39418

Theoretical pI: Translated: 6.88; Mature: 6.88

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.9 %Cys     (Translated Protein)
2.6 %Met     (Translated Protein)
3.4 %Cys+Met (Translated Protein)
0.9 %Cys     (Mature Protein)
2.3 %Met     (Mature Protein)
3.1 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MALRQGSAMQYTKLPHSSLEISKICLGTMTFGEQNSQADAFQQLDYALERGVNFIDTAEM
CCCCCCCCCEECCCCCCCCHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHCCCEEECCCC
YPVPPTAQTQGKTEEFIGNWLAKSGKREKIVLATKVAGPRNVPYIRDKMALDHRNIHQAV
CCCCCCCCCCCCHHHHHHHHHHCCCCCCEEEEEEECCCCCCCCCHHHHHHHHHHHHHHHH
DDSLRRLQTDYIDLYQLHWPQRQTNTFGQLNYPYPDKQEEVTLIETLEALNDLVRMGKVR
HHHHHHHHHHHHHHHHHCCCCHHCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHCCEE
YIGVSNETPWGVMSYLRLAEKHELPRIVSIQNPYNLLNRSFEVGLAEISHLEGVKLLAYS
EEECCCCCCHHHHHHHHHHHHHCCCCEEEECCCHHHHHHHHHHHHHHHHHHCCCEEEEEC
PLAFGALSGKYLNGARPAGARCTLHQRFSRYFTEQGILATEAYVALAQQFGLDPAQMALA
CHHHHCCCCCCCCCCCCCCCCHHHHHHHHHHHHHCCCHHHHHHHHHHHHHCCCHHHHHHH
FVNQRPFVASNIIGATTMEQLKSNLDSLDISLNAELLQKIQEIGTTYSNPCP
HHCCCCCHHHHHHHHHHHHHHHHCCCCEEEEECHHHHHHHHHHCCCCCCCCC
>Mature Secondary Structure 
ALRQGSAMQYTKLPHSSLEISKICLGTMTFGEQNSQADAFQQLDYALERGVNFIDTAEM
CCCCCCCCEECCCCCCCCHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHCCCEEECCCC
YPVPPTAQTQGKTEEFIGNWLAKSGKREKIVLATKVAGPRNVPYIRDKMALDHRNIHQAV
CCCCCCCCCCCCHHHHHHHHHHCCCCCCEEEEEEECCCCCCCCCHHHHHHHHHHHHHHHH
DDSLRRLQTDYIDLYQLHWPQRQTNTFGQLNYPYPDKQEEVTLIETLEALNDLVRMGKVR
HHHHHHHHHHHHHHHHHCCCCHHCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHCCEE
YIGVSNETPWGVMSYLRLAEKHELPRIVSIQNPYNLLNRSFEVGLAEISHLEGVKLLAYS
EEECCCCCCHHHHHHHHHHHHHCCCCEEEECCCHHHHHHHHHHHHHHHHHHCCCEEEEEC
PLAFGALSGKYLNGARPAGARCTLHQRFSRYFTEQGILATEAYVALAQQFGLDPAQMALA
CHHHHCCCCCCCCCCCCCCCCHHHHHHHHHHHHHCCCHHHHHHHHHHHHHCCCHHHHHHH
FVNQRPFVASNIIGATTMEQLKSNLDSLDISLNAELLQKIQEIGTTYSNPCP
HHCCCCCHHHHHHHHHHHHHHHHCCCCEEEEECHHHHHHHHHHCCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: 9560382; 9278503 [H]