Definition Agrobacterium vitis S4 plasmid pAtS4e, complete sequence.
Accession NC_011981
Length 631,775

Click here to switch to the map view.

The map label for this gene is xerD [H]

Identifier: 222102418

GI number: 222102418

Start: 7955

End: 9118

Strand: Reverse

Name: xerD [H]

Synonym: Avi_7008

Alternate gene names: 222102418

Gene position: 9118-7955 (Counterclockwise)

Preceding gene: 222102419

Following gene: 222102416

Centisome position: 1.44

GC content: 61.86

Gene sequence:

>1164_bases
ATGGCCCAGATCGTCGAGAAAGACACCGAAATTCACGTCGAGCAGACCTCAGCGCCGCCGCTCAGCACGGCGGTTGAGGG
TAATGTTTGCGCGCCGCCGCTGTCGGCCGCCGGCCTCTCGCTGCAGGCCCCTCCCCTGCTCTCTCCAGTCAACGAGGACC
AAACGCCGACGCATCTCACCAGCCTGGCGAGCCGCGCCCGCGATTATGTGGAGGCGGCACGTTCTGCCAACACGCGTAAA
GCCTATGCCTGCGATTGGAAGCATTTTAGCGCCTGGTGCCGACGGTTGAATTTGCGGCCCCTCCCCCCGGACCCGCAGAC
CGTTGGCCTCTATATCACCGCCTGCGCCTCAGGCAATGCCGTTGGAACACCGACGCGTGGCGCCAAGACAAACGCGGTTT
CGACCATCGAACGTCGCCTCTCCTCATTGTCTTGGAACTACGCGCAGCGCGGACTCACGCTCGATCGCAAGGATCGGCAT
ATCGCCACCGTCATGGCCGGTATTCGAAACAGCCACGCCCGCCCGCCCGTGCAGAAGGAAGCGGTGTTGGCCGAGGATAT
CATCGCGATGATCGAGACACTCGATCGGGGAACGCTGAGAGGTTTGCGCGATCGGGCCATGCTGCTGATCGGTTATGCCG
GTGGTCTGCGGCGGTCCGAGATTGTCGGTCTCGACATCAAACCTGACCAAACCGAAGACGGGCGCGGCTGGATCGAAATA
TTCGACAAAGGCATGCTCGTCACCCTGCGCGGCAAGACGGGCTGGCGCGAGGTCGAAATCGGCCGCGGATCCTCCGATAC
CACCTGCCCGGTGGTCGCTGTCGAAAGCTGGATCACCTTTGCCAGACTTGCCCATGGCCCCCTCTTCCGCCGCGTCACAG
GACAAGGCAAGTCCATTGGGCCAAACCGTTTGAACGATAAGGAAGTGGCAAGGCTGGTCAAGCGGGCTGCCATGGCTGCC
GGGGTTCGTGGCGATCTCAGCGAGATTGAACGCGCCTTCAAATTCTCCGGCCATTCCCTGCGCGCCGGTCTCGCCTCCTC
CGCCGAAGTCGACGAACGCTATATCCAGAAGCAACTCGGTCATGCCTCAGCCGAGATGACCCGTAGGTACCAGCGGAGAA
GGGATCGTTTCAGGGTCAATTTGACCAAAGCCGCGGGACTTTAA

Upstream 100 bases:

>100_bases
CAGTATATATCAGAAATATCGCAACAAACCGCGCATATCGTCACCACATAAATACGTCCAATAATCTTGCATTATCGGCC
GTTATTGTCATTATAGAGAA

Downstream 100 bases:

>100_bases
TTTTGTTCGTTTGAACCAGAAAATTCGCATCCCGTGAATTGCTGATCACAATATTTAGCCCGTGAAAATAGGATTTTTCG
GCCACGAACCCGATTCAGAC

Product: phage integrase family protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 387; Mature: 386

Protein sequence:

>387_residues
MAQIVEKDTEIHVEQTSAPPLSTAVEGNVCAPPLSAAGLSLQAPPLLSPVNEDQTPTHLTSLASRARDYVEAARSANTRK
AYACDWKHFSAWCRRLNLRPLPPDPQTVGLYITACASGNAVGTPTRGAKTNAVSTIERRLSSLSWNYAQRGLTLDRKDRH
IATVMAGIRNSHARPPVQKEAVLAEDIIAMIETLDRGTLRGLRDRAMLLIGYAGGLRRSEIVGLDIKPDQTEDGRGWIEI
FDKGMLVTLRGKTGWREVEIGRGSSDTTCPVVAVESWITFARLAHGPLFRRVTGQGKSIGPNRLNDKEVARLVKRAAMAA
GVRGDLSEIERAFKFSGHSLRAGLASSAEVDERYIQKQLGHASAEMTRRYQRRRDRFRVNLTKAAGL

Sequences:

>Translated_387_residues
MAQIVEKDTEIHVEQTSAPPLSTAVEGNVCAPPLSAAGLSLQAPPLLSPVNEDQTPTHLTSLASRARDYVEAARSANTRK
AYACDWKHFSAWCRRLNLRPLPPDPQTVGLYITACASGNAVGTPTRGAKTNAVSTIERRLSSLSWNYAQRGLTLDRKDRH
IATVMAGIRNSHARPPVQKEAVLAEDIIAMIETLDRGTLRGLRDRAMLLIGYAGGLRRSEIVGLDIKPDQTEDGRGWIEI
FDKGMLVTLRGKTGWREVEIGRGSSDTTCPVVAVESWITFARLAHGPLFRRVTGQGKSIGPNRLNDKEVARLVKRAAMAA
GVRGDLSEIERAFKFSGHSLRAGLASSAEVDERYIQKQLGHASAEMTRRYQRRRDRFRVNLTKAAGL
>Mature_386_residues
AQIVEKDTEIHVEQTSAPPLSTAVEGNVCAPPLSAAGLSLQAPPLLSPVNEDQTPTHLTSLASRARDYVEAARSANTRKA
YACDWKHFSAWCRRLNLRPLPPDPQTVGLYITACASGNAVGTPTRGAKTNAVSTIERRLSSLSWNYAQRGLTLDRKDRHI
ATVMAGIRNSHARPPVQKEAVLAEDIIAMIETLDRGTLRGLRDRAMLLIGYAGGLRRSEIVGLDIKPDQTEDGRGWIEIF
DKGMLVTLRGKTGWREVEIGRGSSDTTCPVVAVESWITFARLAHGPLFRRVTGQGKSIGPNRLNDKEVARLVKRAAMAAG
VRGDLSEIERAFKFSGHSLRAGLASSAEVDERYIQKQLGHASAEMTRRYQRRRDRFRVNLTKAAGL

Specific function: Site-Specific Tyrosine Recombinase, Which Acts By Catalyzing The Cutting And Rejoining Of The Recombining DNA Molecules. Binds Cooperatively To Specific DNA Consensus Sequences That Are Separated From Xerd Binding Sites By A Short Central Region, Forming

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the 'phage' integrase family [H]

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR011010
- InterPro:   IPR013762
- InterPro:   IPR002104
- InterPro:   IPR010998
- InterPro:   IPR023109 [H]

Pfam domain/function: PF00589 Phage_integrase [H]

EC number: NA

Molecular weight: Translated: 42450; Mature: 42319

Theoretical pI: Translated: 10.47; Mature: 10.47

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.3 %Cys     (Translated Protein)
1.8 %Met     (Translated Protein)
3.1 %Cys+Met (Translated Protein)
1.3 %Cys     (Mature Protein)
1.6 %Met     (Mature Protein)
2.8 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MAQIVEKDTEIHVEQTSAPPLSTAVEGNVCAPPLSAAGLSLQAPPLLSPVNEDQTPTHLT
CCCCCCCCCEEEEECCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHHH
SLASRARDYVEAARSANTRKAYACDWKHFSAWCRRLNLRPLPPDPQTVGLYITACASGNA
HHHHHHHHHHHHHHCCCCCCEEEECHHHHHHHHHHCCCCCCCCCCCEEEEEEEEECCCCC
VGTPTRGAKTNAVSTIERRLSSLSWNYAQRGLTLDRKDRHIATVMAGIRNSHARPPVQKE
CCCCCCCCCHHHHHHHHHHHHHCCHHHHHCCCCCCCCCHHHHHHHHHHHCCCCCCCHHHH
AVLAEDIIAMIETLDRGTLRGLRDRAMLLIGYAGGLRRSEIVGLDIKPDQTEDGRGWIEI
HHHHHHHHHHHHHHHHHHHHHHHHCEEEEEEECCCCCCCCEEEECCCCCCCCCCCCEEEE
FDKGMLVTLRGKTGWREVEIGRGSSDTTCPVVAVESWITFARLAHGPLFRRVTGQGKSIG
ECCCEEEEEECCCCCEEEEECCCCCCCCCHHHHHHHHHHHHHHHCCHHHHHHCCCCCCCC
PNRLNDKEVARLVKRAAMAAGVRGDLSEIERAFKFSGHSLRAGLASSAEVDERYIQKQLG
CCCCCHHHHHHHHHHHHHHCCCCCCHHHHHHHHHCCCCHHHHCCCCCHHHHHHHHHHHHC
HASAEMTRRYQRRRDRFRVNLTKAAGL
CHHHHHHHHHHHHHHHEEEEEHHHCCC
>Mature Secondary Structure 
AQIVEKDTEIHVEQTSAPPLSTAVEGNVCAPPLSAAGLSLQAPPLLSPVNEDQTPTHLT
CCCCCCCCEEEEECCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHHH
SLASRARDYVEAARSANTRKAYACDWKHFSAWCRRLNLRPLPPDPQTVGLYITACASGNA
HHHHHHHHHHHHHHCCCCCCEEEECHHHHHHHHHHCCCCCCCCCCCEEEEEEEEECCCCC
VGTPTRGAKTNAVSTIERRLSSLSWNYAQRGLTLDRKDRHIATVMAGIRNSHARPPVQKE
CCCCCCCCCHHHHHHHHHHHHHCCHHHHHCCCCCCCCCHHHHHHHHHHHCCCCCCCHHHH
AVLAEDIIAMIETLDRGTLRGLRDRAMLLIGYAGGLRRSEIVGLDIKPDQTEDGRGWIEI
HHHHHHHHHHHHHHHHHHHHHHHHCEEEEEEECCCCCCCCEEEECCCCCCCCCCCCEEEE
FDKGMLVTLRGKTGWREVEIGRGSSDTTCPVVAVESWITFARLAHGPLFRRVTGQGKSIG
ECCCEEEEEECCCCCEEEEECCCCCCCCCHHHHHHHHHHHHHHHCCHHHHHHCCCCCCCC
PNRLNDKEVARLVKRAAMAAGVRGDLSEIERAFKFSGHSLRAGLASSAEVDERYIQKQLG
CCCCCHHHHHHHHHHHHHHCCCCCCHHHHHHHHHCCCCHHHHCCCCCHHHHHHHHHHHHC
HASAEMTRRYQRRRDRFRVNLTKAAGL
CHHHHHHHHHHHHHHHEEEEEHHHCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: DNA [C]

Specific reaction: Protein + DNA = Protein-DNA [C]

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 11073919 [H]