| Definition | Sodalis glossinidius str. 'morsitans', complete genome. |
|---|---|
| Accession | NC_007712 |
| Length | 4,171,146 |
Click here to switch to the map view.
The map label for this gene is tyrB [H]
Identifier: 85060109
GI number: 85060109
Start: 3700499
End: 3701695
Strand: Reverse
Name: tyrB [H]
Synonym: SG2131
Alternate gene names: 85060109
Gene position: 3701695-3700499 (Counterclockwise)
Preceding gene: 85060110
Following gene: 85060108
Centisome position: 88.75
GC content: 56.47
Gene sequence:
>1197_bases GTGTTCCGAAATGTTGATGCTTATGCGGGAGATCCTATCCTTACGCTGATGGAAACCTATAAACAGGATCCGCGACCTGA CAGGGTCAATTTAAGCATCGGCCTTTATTATAATGAACAGGCGATCATTCCCCAACTGCAGGCCGTCGCCGAGGCGCAAG CCATGCTGCTCGCCCGGGCGACGTCAAGTTCGTCGTCCTATCTGCCGATAGAAGGCTTGTCAACCTACCGCAGCGCCACC CAGGCGTTGCTATTTGGTGAAGATCATCCGATGCGCAATGCGTTGCGTATCGCCACGATTCAGACCGTGGGCGGGTCAGG GGCGTTGAAAGTCGGGGCGGATTTTCTCAAATGTTATTTCCCGGATTCGCAGGTCTGGGTCAGCGACCCGACCTGGGAAA ACCATGTGGCGATTTTTTCCGGCGCCGGATTCCAAGTGAACCGGTACCCTTATTTCGATGATGAGAAGCTGGGTGTTAAC TTCAGCGCGATGCTGGCCTGTTTCCAGCAATTGCCGCCGCGCAGCATTGTGTTGCTGCATCAGTGTTGCCATAACCCGAC CGGCTCGGACCTGACACGTTCCGAATGGGAGCAGATTATCGCGGTGGTGGCAGAAAGGCAGCTCATCCCCTTTCTGGATA TCGCCTACCAGGGGTTTGGCGACGGGTTGGAGGAAGACGCCTTTGCGGTGCGCGAAATGGCGCGGCTGGGCCTGCCTTGC ATGGTAACTCATTCTTTATCAAAGATTTTCTCTCTTTATAGTGAACGTGTGGGAGAGCTATCGATAGTTTGCGATAGCGC GAGCGAAGCCGAGCGGGTGCTGAGTCAGCTGAAGGCGACCGTGCGCCGCAACTATTCCAGTCCGCCAAACTTTGGCGCTC AGGTTGTGGCGCAAGTTCTGAACGAACCGGCGTTGAATACCCTGTGGCGTGAGGAAGTCGCGGCAATGCGCCAGCGTATT CTGGCAATGCGCCATAGCCTGGTGGCGGCATTGAAAGTCGCGCTGCCGGACCATCAATTCGATTATCTCCTGCGTCAGCG CGGCATGTTCAGCTACACCGGTCTCAGCCCGGCGCAGGTGGCGGATTTGCGCGATACCTTCGGCGTGTATTTAATCGACA GTGGCCGGATGTGTCTGGCCGGCCTGAATACCGCCAATGTCGCTAAAGTGGCCGAGGCCTTCGCGGCAGTGCAGTAA
Upstream 100 bases:
>100_bases TGACGCTTTTTGTTAACTTATTCGCCCTTCAAATCTCTTTATTTGATGTTGTGATGAAGTGGGTGCACTTTTGCACCCGT AAATCCAGGAGAGCTGCACC
Downstream 100 bases:
>100_bases TCGCCCTGCCGTGACCGGTTTTCACCTGTTCCCGCGTTGCCACTATACTAAGTGATCAACAAAGGAGCAGGATTACGTGG CACCAACAGACCCTGAAAGC
Product: aromatic amino acid aminotransferase
Products: NA
Alternate protein names: ARAT; AROAT [H]
Number of amino acids: Translated: 398; Mature: 398
Protein sequence:
>398_residues MFRNVDAYAGDPILTLMETYKQDPRPDRVNLSIGLYYNEQAIIPQLQAVAEAQAMLLARATSSSSSYLPIEGLSTYRSAT QALLFGEDHPMRNALRIATIQTVGGSGALKVGADFLKCYFPDSQVWVSDPTWENHVAIFSGAGFQVNRYPYFDDEKLGVN FSAMLACFQQLPPRSIVLLHQCCHNPTGSDLTRSEWEQIIAVVAERQLIPFLDIAYQGFGDGLEEDAFAVREMARLGLPC MVTHSLSKIFSLYSERVGELSIVCDSASEAERVLSQLKATVRRNYSSPPNFGAQVVAQVLNEPALNTLWREEVAAMRQRI LAMRHSLVAALKVALPDHQFDYLLRQRGMFSYTGLSPAQVADLRDTFGVYLIDSGRMCLAGLNTANVAKVAEAFAAVQ
Sequences:
>Translated_398_residues MFRNVDAYAGDPILTLMETYKQDPRPDRVNLSIGLYYNEQAIIPQLQAVAEAQAMLLARATSSSSSYLPIEGLSTYRSAT QALLFGEDHPMRNALRIATIQTVGGSGALKVGADFLKCYFPDSQVWVSDPTWENHVAIFSGAGFQVNRYPYFDDEKLGVN FSAMLACFQQLPPRSIVLLHQCCHNPTGSDLTRSEWEQIIAVVAERQLIPFLDIAYQGFGDGLEEDAFAVREMARLGLPC MVTHSLSKIFSLYSERVGELSIVCDSASEAERVLSQLKATVRRNYSSPPNFGAQVVAQVLNEPALNTLWREEVAAMRQRI LAMRHSLVAALKVALPDHQFDYLLRQRGMFSYTGLSPAQVADLRDTFGVYLIDSGRMCLAGLNTANVAKVAEAFAAVQ >Mature_398_residues MFRNVDAYAGDPILTLMETYKQDPRPDRVNLSIGLYYNEQAIIPQLQAVAEAQAMLLARATSSSSSYLPIEGLSTYRSAT QALLFGEDHPMRNALRIATIQTVGGSGALKVGADFLKCYFPDSQVWVSDPTWENHVAIFSGAGFQVNRYPYFDDEKLGVN FSAMLACFQQLPPRSIVLLHQCCHNPTGSDLTRSEWEQIIAVVAERQLIPFLDIAYQGFGDGLEEDAFAVREMARLGLPC MVTHSLSKIFSLYSERVGELSIVCDSASEAERVLSQLKATVRRNYSSPPNFGAQVVAQVLNEPALNTLWREEVAAMRQRI LAMRHSLVAALKVALPDHQFDYLLRQRGMFSYTGLSPAQVADLRDTFGVYLIDSGRMCLAGLNTANVAKVAEAFAAVQ
Specific function: Biosynthesis of Phe, Tyr, Asp and Leu. [C]
COG id: COG1448
COG function: function code E; Aspartate/tyrosine/aromatic aminotransferase
Gene ontology:
Cell location: Cytoplasm [H]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the class-I pyridoxal-phosphate-dependent aminotransferase family [H]
Homologues:
Organism=Homo sapiens, GI73486658, Length=390, Percent_Identity=40, Blast_Score=302, Evalue=4e-82, Organism=Homo sapiens, GI4504067, Length=397, Percent_Identity=40.3022670025189, Blast_Score=293, Evalue=2e-79, Organism=Homo sapiens, GI117414139, Length=382, Percent_Identity=27.7486910994764, Blast_Score=174, Evalue=1e-43, Organism=Escherichia coli, GI1790488, Length=397, Percent_Identity=68.2619647355164, Blast_Score=564, Evalue=1e-162, Organism=Escherichia coli, GI1787159, Length=397, Percent_Identity=41.8136020151133, Blast_Score=337, Evalue=6e-94, Organism=Caenorhabditis elegans, GI71981858, Length=397, Percent_Identity=37.5314861460957, Blast_Score=303, Evalue=9e-83, Organism=Caenorhabditis elegans, GI25147133, Length=388, Percent_Identity=38.4020618556701, Blast_Score=284, Evalue=5e-77, Organism=Caenorhabditis elegans, GI17569539, Length=378, Percent_Identity=37.3015873015873, Blast_Score=261, Evalue=4e-70, Organism=Caenorhabditis elegans, GI17569537, Length=390, Percent_Identity=29.7435897435897, Blast_Score=182, Evalue=3e-46, Organism=Caenorhabditis elegans, GI17550384, Length=263, Percent_Identity=34.6007604562738, Blast_Score=169, Evalue=3e-42, Organism=Caenorhabditis elegans, GI25147136, Length=213, Percent_Identity=35.2112676056338, Blast_Score=147, Evalue=1e-35, Organism=Saccharomyces cerevisiae, GI6323055, Length=409, Percent_Identity=36.1858190709046, Blast_Score=275, Evalue=8e-75, Organism=Saccharomyces cerevisiae, GI6322743, Length=423, Percent_Identity=33.5697399527187, Blast_Score=231, Evalue=1e-61, Organism=Drosophila melanogaster, GI19922362, Length=386, Percent_Identity=38.3419689119171, Blast_Score=288, Evalue=6e-78, Organism=Drosophila melanogaster, GI24654046, Length=386, Percent_Identity=38.3419689119171, Blast_Score=288, Evalue=7e-78, Organism=Drosophila melanogaster, GI19920542, Length=389, Percent_Identity=37.2750642673522, Blast_Score=277, Evalue=1e-74, Organism=Drosophila melanogaster, GI24580972, Length=398, Percent_Identity=36.9346733668342, Blast_Score=277, Evalue=1e-74, Organism=Drosophila melanogaster, GI24580970, Length=398, Percent_Identity=36.9346733668342, Blast_Score=276, Evalue=1e-74,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR004839 - InterPro: IPR000796 - InterPro: IPR004838 - InterPro: IPR015424 - InterPro: IPR015421 [H]
Pfam domain/function: PF00155 Aminotran_1_2 [H]
EC number: =2.6.1.57 [H]
Molecular weight: Translated: 44007; Mature: 44007
Theoretical pI: Translated: 5.42; Mature: 5.42
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.8 %Cys (Translated Protein) 2.8 %Met (Translated Protein) 4.5 %Cys+Met (Translated Protein) 1.8 %Cys (Mature Protein) 2.8 %Met (Mature Protein) 4.5 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MFRNVDAYAGDPILTLMETYKQDPRPDRVNLSIGLYYNEQAIIPQLQAVAEAQAMLLARA CCCCCCCCCCCHHHHHHHHHCCCCCCCEEEEEEEEEECCCHHHHHHHHHHHHHHHHHHHH TSSSSSYLPIEGLSTYRSATQALLFGEDHPMRNALRIATIQTVGGSGALKVGADFLKCYF CCCCCCCCCCCCHHHHHHHHHHHEECCCCCCCHHEEEEEEEECCCCCCHHHHHHHHHEEC PDSQVWVSDPTWENHVAIFSGAGFQVNRYPYFDDEKLGVNFSAMLACFQQLPPRSIVLLH CCCCEEECCCCCCCCEEEEECCCEEECCCCCCCCCCCCCCHHHHHHHHHHCCCHHHHHHH QCCHNPTGSDLTRSEWEQIIAVVAERQLIPFLDIAYQGFGDGLEEDAFAVREMARLGLPC HHHCCCCCCCCCHHHHHHHHHHHHHCCCCHHHHHHHHCCCCCCCHHHHHHHHHHHCCCCH MVTHSLSKIFSLYSERVGELSIVCDSASEAERVLSQLKATVRRNYSSPPNFGAQVVAQVL HHHHHHHHHHHHHHHHCCCEEEEECCHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHH NEPALNTLWREEVAAMRQRILAMRHSLVAALKVALPDHQFDYLLRQRGMFSYTGLSPAQV CCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHCCCCEECCCCHHHH ADLRDTFGVYLIDSGRMCLAGLNTANVAKVAEAFAAVQ HHHHHCCCEEEEECCCEEEEECCHHHHHHHHHHHHHCC >Mature Secondary Structure MFRNVDAYAGDPILTLMETYKQDPRPDRVNLSIGLYYNEQAIIPQLQAVAEAQAMLLARA CCCCCCCCCCCHHHHHHHHHCCCCCCCEEEEEEEEEECCCHHHHHHHHHHHHHHHHHHHH TSSSSSYLPIEGLSTYRSATQALLFGEDHPMRNALRIATIQTVGGSGALKVGADFLKCYF CCCCCCCCCCCCHHHHHHHHHHHEECCCCCCCHHEEEEEEEECCCCCCHHHHHHHHHEEC PDSQVWVSDPTWENHVAIFSGAGFQVNRYPYFDDEKLGVNFSAMLACFQQLPPRSIVLLH CCCCEEECCCCCCCCEEEEECCCEEECCCCCCCCCCCCCCHHHHHHHHHHCCCHHHHHHH QCCHNPTGSDLTRSEWEQIIAVVAERQLIPFLDIAYQGFGDGLEEDAFAVREMARLGLPC HHHCCCCCCCCCHHHHHHHHHHHHHCCCCHHHHHHHHCCCCCCCHHHHHHHHHHHCCCCH MVTHSLSKIFSLYSERVGELSIVCDSASEAERVLSQLKATVRRNYSSPPNFGAQVVAQVL HHHHHHHHHHHHHHHHCCCEEEEECCHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHH NEPALNTLWREEVAAMRQRILAMRHSLVAALKVALPDHQFDYLLRQRGMFSYTGLSPAQV CCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHCCCCEECCCCHHHH ADLRDTFGVYLIDSGRMCLAGLNTANVAKVAEAFAAVQ HHHHHCCCEEEEECCCEEEEECCHHHHHHHHHHHHHCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 3521591; 3907634; 8265357; 9278503; 3308851; 10417420 [H]