| Definition | Rhizobium etli CIAT 652 plasmid pC, complete sequence. |
|---|---|
| Accession | NC_010997 |
| Length | 1,091,523 |
Click here to switch to the map view.
The map label for this gene is ybeQ [H]
Identifier: 190895289
GI number: 190895289
Start: 1060146
End: 1062287
Strand: Reverse
Name: ybeQ [H]
Synonym: RHECIAT_PC0000962
Alternate gene names: 190895289
Gene position: 1062287-1060146 (Counterclockwise)
Preceding gene: 190895290
Following gene: 190895288
Centisome position: 97.32
GC content: 58.31
Gene sequence:
>2142_bases ATGGTTTCCACATCTGCGCAAGGACGAGTCTTACGTTTTTTTATCTGCCTGTTCCTACTGATCGCGTGTCAAGTCTTCAC GGGATCTGCTCACGCAGAAAGGCGTGCGGCAATTGTTATTGGCAATAGCGACTATCCTTTTGCGCCGTTGAGCAATCCCC AGAATGACGCCAAGCTGATCGCCAGTACGCTCACCGAATTGAATTTTGACGTACTGTTGTTTTACGACCTGAAGAAAGAG GCGGTCGGGGATCTCAAAGAGACCGTTCGGACGCATCTGGTCGGTGCCGATATTGCCGTTTTTTACTATGCCGGCCACGC CTTGCAGGCCGCCGGCCGCAATCTCTTATTGCCGGTGGACGTCGATACCAGCTCCGCGCAACGGGTCGTTGCCGATGCAA TCGTGCTCGACGACCTCATCGATATCGTCAAGAACGACCCCGTCGGGCTGAAGCTCTTCATTCTTGATGCATGCAGAAAC AATCCGGCTGCCAATTTCCAGGGTCTGCATCAGGGGCTGGCAGACACTGAGGCGGGAAGTGGGCAGGTCTTGGTGGCTTA CGCAACGAGTGCCGGTGAAGTCGCCTATGATGGCACCGGGCTGAATAGCCCCTATTCGTCGGCGCTCGCCAATGCCCTGC AGCGACCGAACCTTGATGTTTATGATACGTTTCGCACGGTTCGCGGCGATGTCAGGCAAGCGACCGGCAATGCGCAAATA CCTTGGATCACCGGTTCGATTGAAACGCGGTTCGTGTTCCGGCCACAGGCGGCAATCTTGGACGCGGAAGCCGTCGTTCC CCCCGCCGAAACCTCGAGCCCGGTTAAAATTGACGAGGTGCTGTGGACCTTCATCAAGGATAGTCCGGATCCTGCCGATT TCGAGCGCTTCGCAAAGATCTTTCCCCAAAGCGCGCACGCGGCCGAGGCGGAGGAAAAGAGTCGTGTCCAGGTTGCTGCC CTTTCGAAACGCGGGCTCTATGTGCGCGAGAGCCTTGTCGCCTCATCCATTGCCAGCCAGGTGCCGAGCGCGGGCGAGGC CGAGGCTAAGGAGTTCGTCTTCCAGCAATCGGGCGAGCGGGCGGTGAGCGAAACGTTCAGAATGTGGCCGAGTGTACTGC CCGAGACGGCGAGCGGGATGCGCAGTCTTGTGACCGAATGCGATCTTTATGGTGCCGACCCGAACGATCCCCAGCGACAG GTTCCCGGCGTCAGTAATGGTCTCGTCAATGTCCGCGACGCGTTACGGGCCTGCGCCTTTGCGCTTGCAGCAGACCAGAA CAATCCCCGGCTGCAGTATCAGCTTGGTCGTGTTCTCGAGATCGCCGGTCGATATAATTGGGCGGAGTATTTCTATAAAG TCGCCGGCGGCCATCAGTATAGCGCGGCTCTCGTCAACCTTGGCTATATGGCTCGCATGGGGATCGGCCGGAAGGTCGAC TACGACCAGGCGCTCTCCTACTACATGGCGGCCGCAAAAATGGGCAACCTGCGCGCGCGCACCAACGTCGGCACGGCCTA TATTCTTGGCCAAGGGGTCTCGAAGGCGCCGGAAGAAGGCATTCTCTGGTATCGTCTTGCCGCTTCCAGCGGGTGGGCCA ACGCCATCACGGCGCTGGGTGACTGCTACAGGCTGGGCACGGGGGTAAAGCAGGATGCCTCGCAGGCAGTCGCACTTTAC ACTGCGGCGGCCGATACGGGCCAGATCGACGCCATGGCAAATCTAGGCCAGGCCTATATCAGCGGAGAGGGCACCAAGAA GGACCTTGGACGTGGCTTGGAGACCCTGCTCAAGGCAACGGACATGGGCAACAAATACGCCCCCTATTATGCCGCGAGAT TGTACCTGAAAGGCGCCGATAAACTTCCTGCCGATCGGAATCGAGCGCTTTCCCTCTTCAAGTTATCTGCCAATCGCGGC CTGGAACTGGCTAATCTCGATCTTGCCTTCGGTTACGACAAAGGCAGCTTCACGGGAAAGGCGGATGTGCCGCTCGCCTA TTATTATGGGGTGCTGGCCGAAAAGCTGGGCGTCAATCGAGCCGATGAAGCGCGCGCGGCGATCGGCAAGAAGCTCGACG CGGCAACACGGCAGAAGATCGAAGCCCAGGTCGATCTCTTTCTGGAACAGAACGGCAAATGA
Upstream 100 bases:
>100_bases ATCCACTTCAAATTCTCAATTGTGGGAATGAGGCAGACAAGGCGACGTTCGGGCTTTGCTCCGATGGTTTCGGGCGCGGT CTTGTCATGGAGCGATAGTG
Downstream 100 bases:
>100_bases CGTTTCGGAGGTGACCTGAAAGGGGTATCGGCATGGGGATAGCGTATCGCTCGATATCGGATCTGCACAGAACGATTGTC GACGGGTTGCACATGCTGCC
Product: putative peptidase
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 713; Mature: 713
Protein sequence:
>713_residues MVSTSAQGRVLRFFICLFLLIACQVFTGSAHAERRAAIVIGNSDYPFAPLSNPQNDAKLIASTLTELNFDVLLFYDLKKE AVGDLKETVRTHLVGADIAVFYYAGHALQAAGRNLLLPVDVDTSSAQRVVADAIVLDDLIDIVKNDPVGLKLFILDACRN NPAANFQGLHQGLADTEAGSGQVLVAYATSAGEVAYDGTGLNSPYSSALANALQRPNLDVYDTFRTVRGDVRQATGNAQI PWITGSIETRFVFRPQAAILDAEAVVPPAETSSPVKIDEVLWTFIKDSPDPADFERFAKIFPQSAHAAEAEEKSRVQVAA LSKRGLYVRESLVASSIASQVPSAGEAEAKEFVFQQSGERAVSETFRMWPSVLPETASGMRSLVTECDLYGADPNDPQRQ VPGVSNGLVNVRDALRACAFALAADQNNPRLQYQLGRVLEIAGRYNWAEYFYKVAGGHQYSAALVNLGYMARMGIGRKVD YDQALSYYMAAAKMGNLRARTNVGTAYILGQGVSKAPEEGILWYRLAASSGWANAITALGDCYRLGTGVKQDASQAVALY TAAADTGQIDAMANLGQAYISGEGTKKDLGRGLETLLKATDMGNKYAPYYAARLYLKGADKLPADRNRALSLFKLSANRG LELANLDLAFGYDKGSFTGKADVPLAYYYGVLAEKLGVNRADEARAAIGKKLDAATRQKIEAQVDLFLEQNGK
Sequences:
>Translated_713_residues MVSTSAQGRVLRFFICLFLLIACQVFTGSAHAERRAAIVIGNSDYPFAPLSNPQNDAKLIASTLTELNFDVLLFYDLKKE AVGDLKETVRTHLVGADIAVFYYAGHALQAAGRNLLLPVDVDTSSAQRVVADAIVLDDLIDIVKNDPVGLKLFILDACRN NPAANFQGLHQGLADTEAGSGQVLVAYATSAGEVAYDGTGLNSPYSSALANALQRPNLDVYDTFRTVRGDVRQATGNAQI PWITGSIETRFVFRPQAAILDAEAVVPPAETSSPVKIDEVLWTFIKDSPDPADFERFAKIFPQSAHAAEAEEKSRVQVAA LSKRGLYVRESLVASSIASQVPSAGEAEAKEFVFQQSGERAVSETFRMWPSVLPETASGMRSLVTECDLYGADPNDPQRQ VPGVSNGLVNVRDALRACAFALAADQNNPRLQYQLGRVLEIAGRYNWAEYFYKVAGGHQYSAALVNLGYMARMGIGRKVD YDQALSYYMAAAKMGNLRARTNVGTAYILGQGVSKAPEEGILWYRLAASSGWANAITALGDCYRLGTGVKQDASQAVALY TAAADTGQIDAMANLGQAYISGEGTKKDLGRGLETLLKATDMGNKYAPYYAARLYLKGADKLPADRNRALSLFKLSANRG LELANLDLAFGYDKGSFTGKADVPLAYYYGVLAEKLGVNRADEARAAIGKKLDAATRQKIEAQVDLFLEQNGK >Mature_713_residues MVSTSAQGRVLRFFICLFLLIACQVFTGSAHAERRAAIVIGNSDYPFAPLSNPQNDAKLIASTLTELNFDVLLFYDLKKE AVGDLKETVRTHLVGADIAVFYYAGHALQAAGRNLLLPVDVDTSSAQRVVADAIVLDDLIDIVKNDPVGLKLFILDACRN NPAANFQGLHQGLADTEAGSGQVLVAYATSAGEVAYDGTGLNSPYSSALANALQRPNLDVYDTFRTVRGDVRQATGNAQI PWITGSIETRFVFRPQAAILDAEAVVPPAETSSPVKIDEVLWTFIKDSPDPADFERFAKIFPQSAHAAEAEEKSRVQVAA LSKRGLYVRESLVASSIASQVPSAGEAEAKEFVFQQSGERAVSETFRMWPSVLPETASGMRSLVTECDLYGADPNDPQRQ VPGVSNGLVNVRDALRACAFALAADQNNPRLQYQLGRVLEIAGRYNWAEYFYKVAGGHQYSAALVNLGYMARMGIGRKVD YDQALSYYMAAAKMGNLRARTNVGTAYILGQGVSKAPEEGILWYRLAASSGWANAITALGDCYRLGTGVKQDASQAVALY TAAADTGQIDAMANLGQAYISGEGTKKDLGRGLETLLKATDMGNKYAPYYAARLYLKGADKLPADRNRALSLFKLSANRG LELANLDLAFGYDKGSFTGKADVPLAYYYGVLAEKLGVNRADEARAAIGKKLDAATRQKIEAQVDLFLEQNGK
Specific function: Unknown
COG id: COG4249
COG function: function code R; Uncharacterized protein containing caspase domain
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: To E.coli ybeT [H]
Homologues:
Organism=Homo sapiens, GI19923669, Length=259, Percent_Identity=27.7992277992278, Blast_Score=82, Evalue=2e-15, Organism=Escherichia coli, GI87081769, Length=190, Percent_Identity=33.1578947368421, Blast_Score=89, Evalue=9e-19, Organism=Drosophila melanogaster, GI21355295, Length=260, Percent_Identity=25.7692307692308, Blast_Score=73, Evalue=5e-13,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR006597 - InterPro: IPR011990 [H]
Pfam domain/function: PF08238 Sel1 [H]
EC number: NA
Molecular weight: Translated: 76915; Mature: 76915
Theoretical pI: Translated: 5.84; Mature: 5.84
Prosite motif: PS00639 THIOL_PROTEASE_HIS ; PS50208 CASPASE_P20
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.8 %Cys (Translated Protein) 1.3 %Met (Translated Protein) 2.1 %Cys+Met (Translated Protein) 0.8 %Cys (Mature Protein) 1.3 %Met (Mature Protein) 2.1 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MVSTSAQGRVLRFFICLFLLIACQVFTGSAHAERRAAIVIGNSDYPFAPLSNPQNDAKLI CCCCCCCCHHHHHHHHHHHHHHHHHHCCCCCCCCCEEEEECCCCCCCCCCCCCCHHHHHH ASTLTELNFDVLLFYDLKKEAVGDLKETVRTHLVGADIAVFYYAGHALQAAGRNLLLPVD HHHHHHCCCCEEEEEECCHHHHHHHHHHHHHHHHCCCEEEEHHHHHHHHHCCCCEEEEEC VDTSSAQRVVADAIVLDDLIDIVKNDPVGLKLFILDACRNNPAANFQGLHQGLADTEAGS CCCCHHHHHHHHHHHHHHHHHHHCCCCCCEEEEEEECCCCCCCCCHHHHHHCCCCCCCCC GQVLVAYATSAGEVAYDGTGLNSPYSSALANALQRPNLDVYDTFRTVRGDVRQATGNAQI CCEEEEEECCCCCEEECCCCCCCCHHHHHHHHHHCCCCCHHHHHHHHHHHHHHCCCCCCC PWITGSIETRFVFRPQAAILDAEAVVPPAETSSPVKIDEVLWTFIKDSPDPADFERFAKI CEEECCCCEEEEECCCHHHCCCCCCCCCCCCCCCCCHHHHHHHHHCCCCCCCHHHHHHHH FPQSAHAAEAEEKSRVQVAALSKRGLYVRESLVASSIASQVPSAGEAEAKEFVFQQSGER CCCCCCCCCHHHHCCEEEEEHHHCCCHHHHHHHHHHHHHHCCCCCCHHHHHHHHHCCCCH AVSETFRMWPSVLPETASGMRSLVTECDLYGADPNDPQRQVPGVSNGLVNVRDALRACAF HHHHHHHHHHHHCCHHHHHHHHHHHHHHCCCCCCCCCHHHCCCCCCCCCHHHHHHHHHHH ALAADQNNPRLQYQLGRVLEIAGRYNWAEYFYKVAGGHQYSAALVNLGYMARMGIGRKVD HHHCCCCCCEEHHHHHHHHHHHCCCCHHHHHHHHCCCCCHHHHHHHHHHHHHHCCCCCCC YDQALSYYMAAAKMGNLRARTNVGTAYILGQGVSKAPEEGILWYRLAASSGWANAITALG HHHHHHHHHHHHHHCCCEEECCCCEEEEEECCCCCCCCCCEEEEEEECCCCHHHHHHHHH DCYRLGTGVKQDASQAVALYTAAADTGQIDAMANLGQAYISGEGTKKDLGRGLETLLKAT HHHHHCCCCCHHHHCEEEEEEECCCCCCHHHHHHCCHHEECCCCCHHHHHHHHHHHHHHH DMGNKYAPYYAARLYLKGADKLPADRNRALSLFKLSANRGLELANLDLAFGYDKGSFTGK CCCCCCCCCEEEEEEEECCCCCCCCCCCCEEEEEECCCCCCEEEEEEEEEECCCCCCCCC ADVPLAYYYGVLAEKLGVNRADEARAAIGKKLDAATRQKIEAQVDLFLEQNGK CCCCHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHEEEEECCCC >Mature Secondary Structure MVSTSAQGRVLRFFICLFLLIACQVFTGSAHAERRAAIVIGNSDYPFAPLSNPQNDAKLI CCCCCCCCHHHHHHHHHHHHHHHHHHCCCCCCCCCEEEEECCCCCCCCCCCCCCHHHHHH ASTLTELNFDVLLFYDLKKEAVGDLKETVRTHLVGADIAVFYYAGHALQAAGRNLLLPVD HHHHHHCCCCEEEEEECCHHHHHHHHHHHHHHHHCCCEEEEHHHHHHHHHCCCCEEEEEC VDTSSAQRVVADAIVLDDLIDIVKNDPVGLKLFILDACRNNPAANFQGLHQGLADTEAGS CCCCHHHHHHHHHHHHHHHHHHHCCCCCCEEEEEEECCCCCCCCCHHHHHHCCCCCCCCC GQVLVAYATSAGEVAYDGTGLNSPYSSALANALQRPNLDVYDTFRTVRGDVRQATGNAQI CCEEEEEECCCCCEEECCCCCCCCHHHHHHHHHHCCCCCHHHHHHHHHHHHHHCCCCCCC PWITGSIETRFVFRPQAAILDAEAVVPPAETSSPVKIDEVLWTFIKDSPDPADFERFAKI CEEECCCCEEEEECCCHHHCCCCCCCCCCCCCCCCCHHHHHHHHHCCCCCCCHHHHHHHH FPQSAHAAEAEEKSRVQVAALSKRGLYVRESLVASSIASQVPSAGEAEAKEFVFQQSGER CCCCCCCCCHHHHCCEEEEEHHHCCCHHHHHHHHHHHHHHCCCCCCHHHHHHHHHCCCCH AVSETFRMWPSVLPETASGMRSLVTECDLYGADPNDPQRQVPGVSNGLVNVRDALRACAF HHHHHHHHHHHHCCHHHHHHHHHHHHHHCCCCCCCCCHHHCCCCCCCCCHHHHHHHHHHH ALAADQNNPRLQYQLGRVLEIAGRYNWAEYFYKVAGGHQYSAALVNLGYMARMGIGRKVD HHHCCCCCCEEHHHHHHHHHHHCCCCHHHHHHHHCCCCCHHHHHHHHHHHHHHCCCCCCC YDQALSYYMAAAKMGNLRARTNVGTAYILGQGVSKAPEEGILWYRLAASSGWANAITALG HHHHHHHHHHHHHHCCCEEECCCCEEEEEECCCCCCCCCCEEEEEEECCCCHHHHHHHHH DCYRLGTGVKQDASQAVALYTAAADTGQIDAMANLGQAYISGEGTKKDLGRGLETLLKAT HHHHHCCCCCHHHHCEEEEEEECCCCCCHHHHHHCCHHEECCCCCHHHHHHHHHHHHHHH DMGNKYAPYYAARLYLKGADKLPADRNRALSLFKLSANRGLELANLDLAFGYDKGSFTGK CCCCCCCCCEEEEEEEECCCCCCCCCCCCEEEEEECCCCCCEEEEEEEEEECCCCCCCCC ADVPLAYYYGVLAEKLGVNRADEARAAIGKKLDAATRQKIEAQVDLFLEQNGK CCCCHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHEEEEECCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 8905232; 9278503 [H]