| Definition | Agrobacterium vitis S4 plasmid pAtS4e, complete sequence. |
|---|---|
| Accession | NC_011981 |
| Length | 631,775 |
Click here to switch to the map view.
The map label for this gene is tyrB [H]
Identifier: 222102805
GI number: 222102805
Start: 468870
End: 470054
Strand: Direct
Name: tyrB [H]
Synonym: Avi_7524
Alternate gene names: 222102805
Gene position: 468870-470054 (Clockwise)
Preceding gene: 222102804
Following gene: 222102807
Centisome position: 74.21
GC content: 55.27
Gene sequence:
>1185_bases GTGCTTGATACGCTCACAATGCCGCCACCAGACAAAATCCTCGCCTTGATGCCGATTTTTCGACAGGATAGCCGCAGCCA CAAGCTTGATCTCGGTGTTGGCGTCTATCGTGATGCGTCGGGCATAACCCCTGTGCTGCGGGCTGTCCGAGAGGCCGAAG CGCGGATGTTACAACACCAGACCACAAAGGCTTATATTGGACCTGCGGGTGATGCACTCTATTGCGATCTCATGACAAAA CTGGTCTTTGCGGATCACGCACCAGTTGAGCGCATCCGTGCCATACAGACGCCGGGCGGGGCTGGCGCGCTGACGGTCAT CTGCGGTCTGATTGCCAAGGCAGCGCCAAACGCAACCTTGCTGGTGCCCGATCCAACATGGGTCAATCATCTATCGATCA TCGAGGATAATGGTTTGGCGGTGAAACGCTGGCCCTATCTTGATCCCACCACGGGCGGAGTTGATTTCGAGGCGTTGAAG CAGACCGTTTGCTCGGCAAAAGCGGGTGACGTGATCTTGCTGCATGGTTGCTGTCATAACCCCACCGGCACGGATCTTAA TCAGGCGCAATGGCGTGAACTTGGCGCACTGTTGGCTGAAAAGGGCGTCGTGCCGTTTATCGACATTGCCTATCAGGGTT TCGGTGATGGCCTTGATGAAGATGCATTTGGCGTGCGGTACCTCGCCACCTTGGTTCCTGAAATGCTGGTTGCCTCTTCA TGCTCCAAGAATTTCGGCATCTACCGTGATCGTACAGGCGTGGCCTTTGTACTGGGCCAGACACAGAAACAGGCCGAAAT TGCTGCCGCACAGATGGTGGTCAGGGCCCGTATTGCCTATTCCATGCCCCCGGATCATGGCTCCCGCATTGTCAGCACCA TCCTTCAGGATGCGGATCTATCGGCAGACTGGCGAGCAGAACTGGAGGACATGCGCAATAACATCATCGGCCTGCGTCAA GCGCTTGCCAAGGCGTTCCAACTTAGAACCCAGAGCAACCACTATGATTTCCTTATCGCCAACAAGGGCATGTTTTCAAA GCTGGGCGTGACACCGCAACAGGTCGAGCGATTGCGCAACGAGTTTGCAATTTACATGGTTGAGGACAGTCGTATCAACA TTGCGGGGCTGCGCCACGAGCAGATCAACAATTTTGTGGAAGCGGTGGTGAGCGTGACACGCTGA
Upstream 100 bases:
>100_bases CAGCAGCTTGCCATCATGTCTAGCAGGATTGCATAATCAACATAAACGGTCTCAGACACGGCACACGGTGCCATCATGTG CACAGCAGAGGACAGATATC
Downstream 100 bases:
>100_bases AACGCTTATCGCGCAAGGCCCTCATGTAATTTCTTGCCAAACACATCCACCAGCGTTTTCATCACGGCGCGCTCAGCGCC GGATAGCTCCCGATCAGCGG
Product: aromatic amino acid aminotransferase
Products: NA
Alternate protein names: ARAT; AROAT [H]
Number of amino acids: Translated: 394; Mature: 394
Protein sequence:
>394_residues MLDTLTMPPPDKILALMPIFRQDSRSHKLDLGVGVYRDASGITPVLRAVREAEARMLQHQTTKAYIGPAGDALYCDLMTK LVFADHAPVERIRAIQTPGGAGALTVICGLIAKAAPNATLLVPDPTWVNHLSIIEDNGLAVKRWPYLDPTTGGVDFEALK QTVCSAKAGDVILLHGCCHNPTGTDLNQAQWRELGALLAEKGVVPFIDIAYQGFGDGLDEDAFGVRYLATLVPEMLVASS CSKNFGIYRDRTGVAFVLGQTQKQAEIAAAQMVVRARIAYSMPPDHGSRIVSTILQDADLSADWRAELEDMRNNIIGLRQ ALAKAFQLRTQSNHYDFLIANKGMFSKLGVTPQQVERLRNEFAIYMVEDSRINIAGLRHEQINNFVEAVVSVTR
Sequences:
>Translated_394_residues MLDTLTMPPPDKILALMPIFRQDSRSHKLDLGVGVYRDASGITPVLRAVREAEARMLQHQTTKAYIGPAGDALYCDLMTK LVFADHAPVERIRAIQTPGGAGALTVICGLIAKAAPNATLLVPDPTWVNHLSIIEDNGLAVKRWPYLDPTTGGVDFEALK QTVCSAKAGDVILLHGCCHNPTGTDLNQAQWRELGALLAEKGVVPFIDIAYQGFGDGLDEDAFGVRYLATLVPEMLVASS CSKNFGIYRDRTGVAFVLGQTQKQAEIAAAQMVVRARIAYSMPPDHGSRIVSTILQDADLSADWRAELEDMRNNIIGLRQ ALAKAFQLRTQSNHYDFLIANKGMFSKLGVTPQQVERLRNEFAIYMVEDSRINIAGLRHEQINNFVEAVVSVTR >Mature_394_residues MLDTLTMPPPDKILALMPIFRQDSRSHKLDLGVGVYRDASGITPVLRAVREAEARMLQHQTTKAYIGPAGDALYCDLMTK LVFADHAPVERIRAIQTPGGAGALTVICGLIAKAAPNATLLVPDPTWVNHLSIIEDNGLAVKRWPYLDPTTGGVDFEALK QTVCSAKAGDVILLHGCCHNPTGTDLNQAQWRELGALLAEKGVVPFIDIAYQGFGDGLDEDAFGVRYLATLVPEMLVASS CSKNFGIYRDRTGVAFVLGQTQKQAEIAAAQMVVRARIAYSMPPDHGSRIVSTILQDADLSADWRAELEDMRNNIIGLRQ ALAKAFQLRTQSNHYDFLIANKGMFSKLGVTPQQVERLRNEFAIYMVEDSRINIAGLRHEQINNFVEAVVSVTR
Specific function: Shows activities toward both dicarboxylic and aromatic substrates [H]
COG id: COG1448
COG function: function code E; Aspartate/tyrosine/aromatic aminotransferase
Gene ontology:
Cell location: Cytoplasm [H]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the class-I pyridoxal-phosphate-dependent aminotransferase family [H]
Homologues:
Organism=Homo sapiens, GI73486658, Length=396, Percent_Identity=34.3434343434343, Blast_Score=256, Evalue=4e-68, Organism=Homo sapiens, GI4504067, Length=385, Percent_Identity=30.6493506493506, Blast_Score=212, Evalue=6e-55, Organism=Homo sapiens, GI117414139, Length=381, Percent_Identity=24.1469816272966, Blast_Score=118, Evalue=7e-27, Organism=Escherichia coli, GI1787159, Length=395, Percent_Identity=41.7721518987342, Blast_Score=330, Evalue=8e-92, Organism=Escherichia coli, GI1790488, Length=386, Percent_Identity=38.3419689119171, Blast_Score=288, Evalue=5e-79, Organism=Caenorhabditis elegans, GI71981858, Length=392, Percent_Identity=35.4591836734694, Blast_Score=270, Evalue=9e-73, Organism=Caenorhabditis elegans, GI25147133, Length=394, Percent_Identity=34.2639593908629, Blast_Score=253, Evalue=9e-68, Organism=Caenorhabditis elegans, GI17569539, Length=400, Percent_Identity=30.25, Blast_Score=194, Evalue=7e-50, Organism=Caenorhabditis elegans, GI17569537, Length=399, Percent_Identity=26.0651629072682, Blast_Score=143, Evalue=2e-34, Organism=Caenorhabditis elegans, GI25147136, Length=206, Percent_Identity=34.4660194174757, Blast_Score=135, Evalue=4e-32, Organism=Caenorhabditis elegans, GI17550384, Length=267, Percent_Identity=28.0898876404494, Blast_Score=120, Evalue=2e-27, Organism=Saccharomyces cerevisiae, GI6323055, Length=410, Percent_Identity=31.9512195121951, Blast_Score=224, Evalue=1e-59, Organism=Saccharomyces cerevisiae, GI6322743, Length=425, Percent_Identity=28, Blast_Score=179, Evalue=5e-46, Organism=Drosophila melanogaster, GI24580972, Length=397, Percent_Identity=34.0050377833753, Blast_Score=244, Evalue=5e-65, Organism=Drosophila melanogaster, GI24580970, Length=400, Percent_Identity=33.75, Blast_Score=244, Evalue=6e-65, Organism=Drosophila melanogaster, GI19920542, Length=395, Percent_Identity=34.1772151898734, Blast_Score=244, Evalue=6e-65, Organism=Drosophila melanogaster, GI24654046, Length=387, Percent_Identity=32.5581395348837, Blast_Score=216, Evalue=3e-56, Organism=Drosophila melanogaster, GI19922362, Length=387, Percent_Identity=32.5581395348837, Blast_Score=216, Evalue=3e-56,
Paralogues:
None
Copy number: 6,000 Molecules/Cell In: Glucose minimal media [C]
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR004839 - InterPro: IPR000796 - InterPro: IPR015424 - InterPro: IPR015421 [H]
Pfam domain/function: PF00155 Aminotran_1_2 [H]
EC number: =2.6.1.57 [H]
Molecular weight: Translated: 43168; Mature: 43168
Theoretical pI: Translated: 6.60; Mature: 6.60
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.5 %Cys (Translated Protein) 2.8 %Met (Translated Protein) 4.3 %Cys+Met (Translated Protein) 1.5 %Cys (Mature Protein) 2.8 %Met (Mature Protein) 4.3 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MLDTLTMPPPDKILALMPIFRQDSRSHKLDLGVGVYRDASGITPVLRAVREAEARMLQHQ CCCCCCCCCCHHHHHHHHHHHCCCCCCEEEECCEEECCCCCCHHHHHHHHHHHHHHHHHH TTKAYIGPAGDALYCDLMTKLVFADHAPVERIRAIQTPGGAGALTVICGLIAKAAPNATL CCCEEECCCCCHHHHHHHHHHHHCCCCCHHHHHHHCCCCCCHHHHHHHHHHHHCCCCCEE LVPDPTWVNHLSIIEDNGLAVKRWPYLDPTTGGVDFEALKQTVCSAKAGDVILLHGCCHN EECCCCHHCEEEEEECCCEEEEECCCCCCCCCCCCHHHHHHHHHCCCCCCEEEEECCCCC PTGTDLNQAQWRELGALLAEKGVVPFIDIAYQGFGDGLDEDAFGVRYLATLVPEMLVASS CCCCCCCHHHHHHHHHHHHHCCCCCCHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHHH CSKNFGIYRDRTGVAFVLGQTQKQAEIAAAQMVVRARIAYSMPPDHGSRIVSTILQDADL CCCCCCCEECCCCEEEEECCCHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHCCC SADWRAELEDMRNNIIGLRQALAKAFQLRTQSNHYDFLIANKGMFSKLGVTPQQVERLRN CCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCEEEEEECCCCHHHHCCCHHHHHHHHC EFAIYMVEDSRINIAGLRHEQINNFVEAVVSVTR CEEEEEEECCEEEEEECCHHHHHHHHHHHHHHCC >Mature Secondary Structure MLDTLTMPPPDKILALMPIFRQDSRSHKLDLGVGVYRDASGITPVLRAVREAEARMLQHQ CCCCCCCCCCHHHHHHHHHHHCCCCCCEEEECCEEECCCCCCHHHHHHHHHHHHHHHHHH TTKAYIGPAGDALYCDLMTKLVFADHAPVERIRAIQTPGGAGALTVICGLIAKAAPNATL CCCEEECCCCCHHHHHHHHHHHHCCCCCHHHHHHHCCCCCCHHHHHHHHHHHHCCCCCEE LVPDPTWVNHLSIIEDNGLAVKRWPYLDPTTGGVDFEALKQTVCSAKAGDVILLHGCCHN EECCCCHHCEEEEEECCCEEEEECCCCCCCCCCCCHHHHHHHHHCCCCCCEEEEECCCCC PTGTDLNQAQWRELGALLAEKGVVPFIDIAYQGFGDGLDEDAFGVRYLATLVPEMLVASS CCCCCCCHHHHHHHHHHHHHCCCCCCHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHHH CSKNFGIYRDRTGVAFVLGQTQKQAEIAAAQMVVRARIAYSMPPDHGSRIVSTILQDADL CCCCCCCEECCCCEEEEECCCHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHCCC SADWRAELEDMRNNIIGLRQALAKAFQLRTQSNHYDFLIANKGMFSKLGVTPQQVERLRN CCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCEEEEEECCCCHHHHCCCHHHHHHHHC EFAIYMVEDSRINIAGLRHEQINNFVEAVVSVTR CEEEEEEECCEEEEEECCHHHHHHHHHHHHHHCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 9058208; 9665848; 9930977 [H]