| Definition | Agrobacterium vitis S4 plasmid pAtS4e, complete sequence. |
|---|---|
| Accession | NC_011981 |
| Length | 631,775 |
Click here to switch to the map view.
The map label for this gene is orfB [C]
Identifier: 222102941
GI number: 222102941
Start: 630217
End: 631296
Strand: Reverse
Name: orfB [C]
Synonym: Avi_7700
Alternate gene names: 222102941
Gene position: 631296-630217 (Counterclockwise)
Preceding gene: NA
Following gene: 222102939
Centisome position: 99.92
GC content: 55.56
Gene sequence:
>1080_bases ATGAAAGCGTCGAAGTTTACGGAAGCGCAAATCGCGTTTGTGTTGAAGCAGGCTCATGATGGAACGCCCATTGGCGAGGT CTGCCGCAAGGCGGGGATTTCGGACGCTACGTTTTATAACTGGCGCAAAAAAATACACTGGCCTAATGCCGTCAGAGATG AAGCGCCTGCGGCAGTTGGAAGAGGAAAATGCCAAACTGAAGCGGATCGTCGCCGATCTCTCTTTAGACAAGGCCATCCT CCAGGATGTGCTGTCAAAAAAGCTCTGAGGCCTGACGGCAAGCGTCATCTTGTCGACAGGATCAAGACGGACTGGAAGGT TTCGATCCGACGCGCATGCTCCGTCCTGAAGATCGACCGGTCCCTTTATGTCTACAAGTCCAAGCGCGGCGATCAGGCCG AACTGAAGCTGAAGATCAAGGATATCTGCCAGACGCGGGTACGTTATGGCTATCGTCGTGTGCATGTCTTGATCAGGCGT GACGGCTGGGTGGTGAATCCGAAGAGAATCTATCGTCTTTACAAGGAGATGGACCTGCAACTGCGCAACAAGGTGCCAAA ACGGCGCGTCAAAGCAAAGCTGCGATCGCACCGCACCGCAGCCACCCGTTCGAACGACGTCTGGGCCATGGATTTCGTGC ATGACCAACTGGCCACAGGTCGCAAGATCAGGGTTCTCACGGTTGTCGATACCTTCTCGCGCTTCTCTCCGGCGGTAGAT GCCCGCTTCAGCTATAAAGGGGAAGACGTCGTGCAGACCCTCGAACGCGTATGCCGGCAGGTCGGTTACCCGGCCACCAT TCGGATGGACAACGGCAGCGAATTCATCTCTCGTAACCTCGATCTCTGGGCCTATCATAGAGGCGTCGTGCTTGACTTCT CGCGGCCGGGCAAGCCAACGGACAACAGCTACATCGAGAGCTTTATGTATAGACGGCCCCGCGGGCGCAAGAGGCTTCTT ACAAGTTCAGGTCATCATTCGGGTGCGTTCATGTATACGGCCTTTGGATGCGACCGATATTATGGTCGCTGGCCCAGATG GAGTACGCGGATCGAGGCCTCATCAACGGGACGCGCTTGA
Upstream 100 bases:
>100_bases GTTGAGGACTTGCTGGCTTTGACGTGCCCCCGATAAATTATGCCATTTAGAACTGGAATTTTCCACTTATGATTCCTTTT GGGAAGAAGAGGAGAATTCG
Downstream 100 bases:
>100_bases ATGGGCGCTTAAAGCTCTCCGGGCTTGCTCGATCCTCAGCTCCGCTGAGTGACCATCTGTTGCTTCTGCACCTTACGCCA TCTGGATTTTGGGTTGCTGC
Product: IS3 family transposase
Products: NA
Alternate protein names: ORF1 [H]
Number of amino acids: Translated: 359; Mature: 359
Protein sequence:
>359_residues MKASKFTEAQIAFVLKQAHDGTPIGEVCRKAGISDATFYNWRKKIHWPNAVRDEAPAAVGRGKCQTEADRRRSLFRQGHP PGCAVKKALRPDGKRHLVDRIKTDWKVSIRRACSVLKIDRSLYVYKSKRGDQAELKLKIKDICQTRVRYGYRRVHVLIRR DGWVVNPKRIYRLYKEMDLQLRNKVPKRRVKAKLRSHRTAATRSNDVWAMDFVHDQLATGRKIRVLTVVDTFSRFSPAVD ARFSYKGEDVVQTLERVCRQVGYPATIRMDNGSEFISRNLDLWAYHRGVVLDFSRPGKPTDNSYIESFMYRRPRGRKRLL TSSGHHSGAFMYTAFGCDRYYGRWPRWSTRIEASSTGRA
Sequences:
>Translated_359_residues MKASKFTEAQIAFVLKQAHDGTPIGEVCRKAGISDATFYNWRKKIHWPNAVRDEAPAAVGRGKCQTEADRRRSLFRQGHP PGCAVKKALRPDGKRHLVDRIKTDWKVSIRRACSVLKIDRSLYVYKSKRGDQAELKLKIKDICQTRVRYGYRRVHVLIRR DGWVVNPKRIYRLYKEMDLQLRNKVPKRRVKAKLRSHRTAATRSNDVWAMDFVHDQLATGRKIRVLTVVDTFSRFSPAVD ARFSYKGEDVVQTLERVCRQVGYPATIRMDNGSEFISRNLDLWAYHRGVVLDFSRPGKPTDNSYIESFMYRRPRGRKRLL TSSGHHSGAFMYTAFGCDRYYGRWPRWSTRIEASSTGRA >Mature_359_residues MKASKFTEAQIAFVLKQAHDGTPIGEVCRKAGISDATFYNWRKKIHWPNAVRDEAPAAVGRGKCQTEADRRRSLFRQGHP PGCAVKKALRPDGKRHLVDRIKTDWKVSIRRACSVLKIDRSLYVYKSKRGDQAELKLKIKDICQTRVRYGYRRVHVLIRR DGWVVNPKRIYRLYKEMDLQLRNKVPKRRVKAKLRSHRTAATRSNDVWAMDFVHDQLATGRKIRVLTVVDTFSRFSPAVD ARFSYKGEDVVQTLERVCRQVGYPATIRMDNGSEFISRNLDLWAYHRGVVLDFSRPGKPTDNSYIESFMYRRPRGRKRLL TSSGHHSGAFMYTAFGCDRYYGRWPRWSTRIEASSTGRA
Specific function: Unknown
COG id: COG2801
COG function: function code L; Transposase and inactivated derivatives
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 1 integrase catalytic domain [H]
Homologues:
None
Paralogues:
None
Copy number: 10-20 Molecules/Cell [C]
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR001584 - InterPro: IPR012337 [H]
Pfam domain/function: PF00665 rve [H]
EC number: NA
Molecular weight: Translated: 41701; Mature: 41701
Theoretical pI: Translated: 11.14; Mature: 11.14
Prosite motif: PS50994 INTEGRASE
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.9 %Cys (Translated Protein) 1.7 %Met (Translated Protein) 3.6 %Cys+Met (Translated Protein) 1.9 %Cys (Mature Protein) 1.7 %Met (Mature Protein) 3.6 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MKASKFTEAQIAFVLKQAHDGTPIGEVCRKAGISDATFYNWRKKIHWPNAVRDEAPAAVG CCCCCCHHHHHHHHHHHCCCCCCHHHHHHHCCCCCCHHHHHHHHCCCCCCCCCCCCHHHC RGKCQTEADRRRSLFRQGHPPGCAVKKALRPDGKRHLVDRIKTDWKVSIRRACSVLKIDR CCCCCCHHHHHHHHHHCCCCCCHHHHHHHCCCHHHHHHHHHCCCHHHHHHHHHHHHHCCC SLYVYKSKRGDQAELKLKIKDICQTRVRYGYRRVHVLIRRDGWVVNPKRIYRLYKEMDLQ EEEEEECCCCCCHHEEEHHHHHHHHHHHHCCEEEEEEEECCCEEECHHHHHHHHHHHHHH LRNKVPKRRVKAKLRSHRTAATRSNDVWAMDFVHDQLATGRKIRVLTVVDTFSRFSPAVD HHHCCHHHHHHHHHHHHHHHCCCCCCEEEHHHHHHHHHCCCEEEEEEEEHHHHHCCCCCC ARFSYKGEDVVQTLERVCRQVGYPATIRMDNGSEFISRNLDLWAYHRGVVLDFSRPGKPT CEECCCCHHHHHHHHHHHHHCCCCEEEEECCCHHHHHCCCCEEEEECCEEEECCCCCCCC DNSYIESFMYRRPRGRKRLLTSSGHHSGAFMYTAFGCDRYYGRWPRWSTRIEASSTGRA CHHHHHHHHHHCCCCHHHHHCCCCCCCCEEEEEEECCHHHCCCCCCCCCEEECCCCCCC >Mature Secondary Structure MKASKFTEAQIAFVLKQAHDGTPIGEVCRKAGISDATFYNWRKKIHWPNAVRDEAPAAVG CCCCCCHHHHHHHHHHHCCCCCCHHHHHHHCCCCCCHHHHHHHHCCCCCCCCCCCCHHHC RGKCQTEADRRRSLFRQGHPPGCAVKKALRPDGKRHLVDRIKTDWKVSIRRACSVLKIDR CCCCCCHHHHHHHHHHCCCCCCHHHHHHHCCCHHHHHHHHHCCCHHHHHHHHHHHHHCCC SLYVYKSKRGDQAELKLKIKDICQTRVRYGYRRVHVLIRRDGWVVNPKRIYRLYKEMDLQ EEEEEECCCCCCHHEEEHHHHHHHHHHHHCCEEEEEEEECCCEEECHHHHHHHHHHHHHH LRNKVPKRRVKAKLRSHRTAATRSNDVWAMDFVHDQLATGRKIRVLTVVDTFSRFSPAVD HHHCCHHHHHHHHHHHHHHHCCCCCCEEEHHHHHHHHHCCCEEEEEEEEHHHHHCCCCCC ARFSYKGEDVVQTLERVCRQVGYPATIRMDNGSEFISRNLDLWAYHRGVVLDFSRPGKPT CEECCCCHHHHHHHHHHHHHCCCCEEEEECCCHHHHHCCCCEEEEECCEEEECCCCCCCC DNSYIESFMYRRPRGRKRLLTSSGHHSGAFMYTAFGCDRYYGRWPRWSTRIEASSTGRA CHHHHHHHHHHCCCCHHHHHCCCCCCCCEEEEEEECCHHHCCCCCCCCCEEECCCCCCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: DNA [C]
Specific reaction: Protein + DNA = Protein-DNA [C]
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 1718819 [H]