Definition Candidatus Solibacter usitatus Ellin6076 chromosome, complete genome.
Accession NC_008536
Length 9,965,640

Click here to switch to the map view.

The map label for this gene is xerD [C]

Identifier: 116621638

GI number: 116621638

Start: 3194175

End: 3196307

Strand: Direct

Name: xerD [C]

Synonym: Acid_2520

Alternate gene names: 116621638

Gene position: 3194175-3196307 (Clockwise)

Preceding gene: 116621637

Following gene: 116621639

Centisome position: 32.05

GC content: 59.59

Gene sequence:

>2133_bases
ATGCGCGAAAGCGATTTCAGCCGGTGGGCCATCAAACAGTACACGTGTAATGGCCGCCATTTTCTTAACCATATAGTAAG
TCGCGGGATCCGCCTGAAGGCTGTCCGTCCTGATGACGTTGAAGAGTATCTGCGTACTCAGTGGCAGCGATACTGGCGCC
GAAACAGGCACCGGCCGGCAGACGAAGCGGAGTGGCGATCCCGCTTCACGTCCTCGGCTCATATGCTGCTGCGACTGGCG
CAAGGTGCGTGGCCGCCGCTGACTTCATTGGAGTCTCGCGTTCAAACATTCAAAGAAACGCTTGAGCAGGAGCACCTTCG
TCCGGAGACCATCCGACAGTATCTGGATCAGGCCCGCCTATTTCTGGCGTATCTGGATCGACAACAGTTGCTGCTGGAGC
GCGTGACGCCGCAGGATCTCGATGGGTTCATCGCTGAACGCCTCAGAATCTATCGAAGGCAGTTTGGCCATTTGCCTCGC
CGACTTGTGCGCTGGCGCTGCGAGTACACAAAGGCCATCCACCGGCTTCTGCGTGGCGCACAAGAACAATGGCCGCCGCC
TTCGTCGGGCGATCCCGACCTTCAGCAGTTTCAGACCCACCTGACTGAGCGAGGATTGGACCCGAGCTACGTCCAGGATT
ATCTCTGCCACGCTCGTCAGTTTATTGACTACCTGAATCTCAAAGGGATGAGCCTCGCGGCGGTTCGACTGGAAGATGTC
GATGCCTACTTCCGTGTCGCGCTGCGCATCTACCGAAAACGGAAACCGAACCTCCCGAAAAAGCTGGATTACTGGCGAAT
GATCAGCAGGCGCGCGGTTGACGGCCTGCTGCGCTTCACACAGGGCGAATGGCCTCCGGGATCGCGGCCTGAACCGGTGC
TTTCGGATTTCCGGTCGCATTTGGAGAAGTTCCGCTACAACCAGCTCGGGATTCCCAGCTACGTCTCCGCGGCTCGTCAG
TTCATTCGCTACCTGAAACAGCAGGGCCTTTCGATAGAAGCCGCTCGCCCCGCACACGTGGAAAGCTTTATTCAGGCAAA
GTTAGATCGGTTCAAACAACGACACCGCACTTTGCCCAGGCATCCGCGCCAGTGGCGGACCAGGTATTCCGGCGCGATCC
ACCGACTGCTGCGGATGGTGAACCCGAACTGGCCGCCACCGGAACCACCTGCTAACGAGCGCGAACGATTTCAGCGCGAG
GTGATCGACGGCTACGGCCGATGGCTGGTCGATATCCATGGTCTCTCCAAAGGGACCCTCCGCAAGAACGGCGATGCCGC
GCGGGTGTTCGTTCAATGGCTGGGCGATAGGGCGAACCGCGATTCTCTTTCCAGGATCGGCCTTGCCGATATAGACCAGT
ATCTGAGTTGGCGAATGCCGGGACTGCGCCGTGCGACGCGGCATGGCGTGTCGCAGTGTTTGCGAAGTTTTCTGAGGTAT
CTGCACGCCGAGAAGTTCGTTGCCAAAGATCTTTCTCCGGTCGTCTCCGGACCGATCATGTATAAGTTCGAAGACATCCC
CCGCGCTTTTACGGAACCACAGGTGAAGGCGTTGCTGGAGACAACCCGCCAGGACAAAACGCCCACCGGCCTGCGCGACC
ATGCCATTCTGATGCTGCTTTCAACCTATGGTCTGCGAGCTGGCGAGGTGGTTCGCCTGCGGCTCGATGACATCGATTGG
CGTGCTGACCGGCTGCGGGTACGGCAGTCGAAGAGCGGTGCGGGATCGTTTCTACCGCTGCTCCCGCCGGTGGGGGAAGC
ACTGCTGAACTATCTGCGCCGCGGCCGCCCGCAGACGGACATTCGTGAGGTATTCCTGCGCGTCCGCGCGCCGCACGGCG
CGTTTCCATGGGGCGGCTCTCTGCATACCATCATTCAGCGACGGCTGAAGCAGGCCGGCATTCAGGTGAAAGGACGGCAC
GGCGCCCACGCGTTCCGCTTCGCGCGAGCGGGCAGTCTGCTGGAGGCCGATGTGCCATTAAAGTCGATCGGTGATCTGTT
GGGCCATCGCTCGGCGGAATCTACCGAGATTTATCTGCGCCTCGCCACAGAGGATCTCCGGGCAATCAGTATCGACTTGC
CCGGGAAAGGAGAACCATGCCAAATTGGCCGGACCAAGAAGACGAAACGCTGA

Upstream 100 bases:

>100_bases
GCCTTTTTCCGCTTCTGGTCATCTCTTCAGTAGCCTCCCCCCGGAGACAAACATTCCCAGACAACAGATTGACCGTTGGC
TGGTCGCATTGCGCGAACAC

Downstream 100 bases:

>100_bases
TCAACCAGTTCGTGGAACAGCTCAACCTGGTCTGCTATGGCGCGCCCTTCCTATCGCGGCTTCGCCAGTTCCAGCGCTTT
GTCGCGCGGCGTTTTCCCAA

Product: phage integrase family protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 710; Mature: 710

Protein sequence:

>710_residues
MRESDFSRWAIKQYTCNGRHFLNHIVSRGIRLKAVRPDDVEEYLRTQWQRYWRRNRHRPADEAEWRSRFTSSAHMLLRLA
QGAWPPLTSLESRVQTFKETLEQEHLRPETIRQYLDQARLFLAYLDRQQLLLERVTPQDLDGFIAERLRIYRRQFGHLPR
RLVRWRCEYTKAIHRLLRGAQEQWPPPSSGDPDLQQFQTHLTERGLDPSYVQDYLCHARQFIDYLNLKGMSLAAVRLEDV
DAYFRVALRIYRKRKPNLPKKLDYWRMISRRAVDGLLRFTQGEWPPGSRPEPVLSDFRSHLEKFRYNQLGIPSYVSAARQ
FIRYLKQQGLSIEAARPAHVESFIQAKLDRFKQRHRTLPRHPRQWRTRYSGAIHRLLRMVNPNWPPPEPPANERERFQRE
VIDGYGRWLVDIHGLSKGTLRKNGDAARVFVQWLGDRANRDSLSRIGLADIDQYLSWRMPGLRRATRHGVSQCLRSFLRY
LHAEKFVAKDLSPVVSGPIMYKFEDIPRAFTEPQVKALLETTRQDKTPTGLRDHAILMLLSTYGLRAGEVVRLRLDDIDW
RADRLRVRQSKSGAGSFLPLLPPVGEALLNYLRRGRPQTDIREVFLRVRAPHGAFPWGGSLHTIIQRRLKQAGIQVKGRH
GAHAFRFARAGSLLEADVPLKSIGDLLGHRSAESTEIYLRLATEDLRAISIDLPGKGEPCQIGRTKKTKR

Sequences:

>Translated_710_residues
MRESDFSRWAIKQYTCNGRHFLNHIVSRGIRLKAVRPDDVEEYLRTQWQRYWRRNRHRPADEAEWRSRFTSSAHMLLRLA
QGAWPPLTSLESRVQTFKETLEQEHLRPETIRQYLDQARLFLAYLDRQQLLLERVTPQDLDGFIAERLRIYRRQFGHLPR
RLVRWRCEYTKAIHRLLRGAQEQWPPPSSGDPDLQQFQTHLTERGLDPSYVQDYLCHARQFIDYLNLKGMSLAAVRLEDV
DAYFRVALRIYRKRKPNLPKKLDYWRMISRRAVDGLLRFTQGEWPPGSRPEPVLSDFRSHLEKFRYNQLGIPSYVSAARQ
FIRYLKQQGLSIEAARPAHVESFIQAKLDRFKQRHRTLPRHPRQWRTRYSGAIHRLLRMVNPNWPPPEPPANERERFQRE
VIDGYGRWLVDIHGLSKGTLRKNGDAARVFVQWLGDRANRDSLSRIGLADIDQYLSWRMPGLRRATRHGVSQCLRSFLRY
LHAEKFVAKDLSPVVSGPIMYKFEDIPRAFTEPQVKALLETTRQDKTPTGLRDHAILMLLSTYGLRAGEVVRLRLDDIDW
RADRLRVRQSKSGAGSFLPLLPPVGEALLNYLRRGRPQTDIREVFLRVRAPHGAFPWGGSLHTIIQRRLKQAGIQVKGRH
GAHAFRFARAGSLLEADVPLKSIGDLLGHRSAESTEIYLRLATEDLRAISIDLPGKGEPCQIGRTKKTKR
>Mature_710_residues
MRESDFSRWAIKQYTCNGRHFLNHIVSRGIRLKAVRPDDVEEYLRTQWQRYWRRNRHRPADEAEWRSRFTSSAHMLLRLA
QGAWPPLTSLESRVQTFKETLEQEHLRPETIRQYLDQARLFLAYLDRQQLLLERVTPQDLDGFIAERLRIYRRQFGHLPR
RLVRWRCEYTKAIHRLLRGAQEQWPPPSSGDPDLQQFQTHLTERGLDPSYVQDYLCHARQFIDYLNLKGMSLAAVRLEDV
DAYFRVALRIYRKRKPNLPKKLDYWRMISRRAVDGLLRFTQGEWPPGSRPEPVLSDFRSHLEKFRYNQLGIPSYVSAARQ
FIRYLKQQGLSIEAARPAHVESFIQAKLDRFKQRHRTLPRHPRQWRTRYSGAIHRLLRMVNPNWPPPEPPANERERFQRE
VIDGYGRWLVDIHGLSKGTLRKNGDAARVFVQWLGDRANRDSLSRIGLADIDQYLSWRMPGLRRATRHGVSQCLRSFLRY
LHAEKFVAKDLSPVVSGPIMYKFEDIPRAFTEPQVKALLETTRQDKTPTGLRDHAILMLLSTYGLRAGEVVRLRLDDIDW
RADRLRVRQSKSGAGSFLPLLPPVGEALLNYLRRGRPQTDIREVFLRVRAPHGAFPWGGSLHTIIQRRLKQAGIQVKGRH
GAHAFRFARAGSLLEADVPLKSIGDLLGHRSAESTEIYLRLATEDLRAISIDLPGKGEPCQIGRTKKTKR

Specific function: Site-Specific Tyrosine Recombinase, Which Acts By Catalyzing The Cutting And Rejoining Of The Recombining DNA Molecules. Binds Cooperatively To Specific DNA Consensus Sequences That Are Separated From Xerc Binding Sites By A Short Central Region, Forming

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the 'phage' integrase family [H]

Homologues:

Organism=Escherichia coli, GI1789261, Length=286, Percent_Identity=30.7692307692308, Blast_Score=80, Evalue=6e-16,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR011010
- InterPro:   IPR013762
- InterPro:   IPR002104 [H]

Pfam domain/function: PF00589 Phage_integrase [H]

EC number: NA

Molecular weight: Translated: 83086; Mature: 83086

Theoretical pI: Translated: 11.09; Mature: 11.09

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.7 %Cys     (Translated Protein)
1.1 %Met     (Translated Protein)
1.8 %Cys+Met (Translated Protein)
0.7 %Cys     (Mature Protein)
1.1 %Met     (Mature Protein)
1.8 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MRESDFSRWAIKQYTCNGRHFLNHIVSRGIRLKAVRPDDVEEYLRTQWQRYWRRNRHRPA
CCCCCHHHHHHHHHCCCHHHHHHHHHHCCCEEEECCCCHHHHHHHHHHHHHHHHCCCCCC
DEAEWRSRFTSSAHMLLRLAQGAWPPLTSLESRVQTFKETLEQEHLRPETIRQYLDQARL
CHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHH
FLAYLDRQQLLLERVTPQDLDGFIAERLRIYRRQFGHLPRRLVRWRCEYTKAIHRLLRGA
HHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
QEQWPPPSSGDPDLQQFQTHLTERGLDPSYVQDYLCHARQFIDYLNLKGMSLAAVRLEDV
HHCCCCCCCCCCCHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHCCCCCEEEHHHHHHH
DAYFRVALRIYRKRKPNLPKKLDYWRMISRRAVDGLLRFTQGEWPPGSRPEPVLSDFRSH
HHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHH
LEKFRYNQLGIPSYVSAARQFIRYLKQQGLSIEAARPAHVESFIQAKLDRFKQRHRTLPR
HHHHHHCCCCCHHHHHHHHHHHHHHHHCCCCEECCCCHHHHHHHHHHHHHHHHHHCCCCC
HPRQWRTRYSGAIHRLLRMVNPNWPPPEPPANERERFQREVIDGYGRWLVDIHGLSKGTL
CCHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCHHHHHHHHHHHHHCCCEEEEECCCCCCC
RKNGDAARVFVQWLGDRANRDSLSRIGLADIDQYLSWRMPGLRRATRHGVSQCLRSFLRY
CCCCHHHHHHHHHHCCCCCHHHHHHCCHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHH
LHAEKFVAKDLSPVVSGPIMYKFEDIPRAFTEPQVKALLETTRQDKTPTGLRDHAILMLL
HHHHHHHHHHHHHHHCCCCEEEEHHHCHHHCCHHHHHHHHHHHCCCCCCCCHHHHHHHHH
STYGLRAGEVVRLRLDDIDWRADRLRVRQSKSGAGSFLPLLPPVGEALLNYLRRGRPQTD
HHHCCCCCCEEEEEECCCCHHHHHHHHHHCCCCCCCCCCCCCHHHHHHHHHHHCCCCCHH
IREVFLRVRAPHGAFPWGGSLHTIIQRRLKQAGIQVKGRHGAHAFRFARAGSLLEADVPL
HHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHCCCEEECCCCHHHHHHHHCCCCCCCCCCH
KSIGDLLGHRSAESTEIYLRLATEDLRAISIDLPGKGEPCQIGRTKKTKR
HHHHHHHCCCCCCCCEEEEEEECCCCEEEEEECCCCCCCCCCCCCCCCCC
>Mature Secondary Structure
MRESDFSRWAIKQYTCNGRHFLNHIVSRGIRLKAVRPDDVEEYLRTQWQRYWRRNRHRPA
CCCCCHHHHHHHHHCCCHHHHHHHHHHCCCEEEECCCCHHHHHHHHHHHHHHHHCCCCCC
DEAEWRSRFTSSAHMLLRLAQGAWPPLTSLESRVQTFKETLEQEHLRPETIRQYLDQARL
CHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHH
FLAYLDRQQLLLERVTPQDLDGFIAERLRIYRRQFGHLPRRLVRWRCEYTKAIHRLLRGA
HHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
QEQWPPPSSGDPDLQQFQTHLTERGLDPSYVQDYLCHARQFIDYLNLKGMSLAAVRLEDV
HHCCCCCCCCCCCHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHCCCCCEEEHHHHHHH
DAYFRVALRIYRKRKPNLPKKLDYWRMISRRAVDGLLRFTQGEWPPGSRPEPVLSDFRSH
HHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHH
LEKFRYNQLGIPSYVSAARQFIRYLKQQGLSIEAARPAHVESFIQAKLDRFKQRHRTLPR
HHHHHHCCCCCHHHHHHHHHHHHHHHHCCCCEECCCCHHHHHHHHHHHHHHHHHHCCCCC
HPRQWRTRYSGAIHRLLRMVNPNWPPPEPPANERERFQREVIDGYGRWLVDIHGLSKGTL
CCHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCHHHHHHHHHHHHHCCCEEEEECCCCCCC
RKNGDAARVFVQWLGDRANRDSLSRIGLADIDQYLSWRMPGLRRATRHGVSQCLRSFLRY
CCCCHHHHHHHHHHCCCCCHHHHHHCCHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHH
LHAEKFVAKDLSPVVSGPIMYKFEDIPRAFTEPQVKALLETTRQDKTPTGLRDHAILMLL
HHHHHHHHHHHHHHHCCCCEEEEHHHCHHHCCHHHHHHHHHHHCCCCCCCCHHHHHHHHH
STYGLRAGEVVRLRLDDIDWRADRLRVRQSKSGAGSFLPLLPPVGEALLNYLRRGRPQTD
HHHCCCCCCEEEEEECCCCHHHHHHHHHHCCCCCCCCCCCCCHHHHHHHHHHHCCCCCHH
IREVFLRVRAPHGAFPWGGSLHTIIQRRLKQAGIQVKGRHGAHAFRFARAGSLLEADVPL
HHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHCCCEEECCCCHHHHHHHHCCCCCCCCCCH
KSIGDLLGHRSAESTEIYLRLATEDLRAISIDLPGKGEPCQIGRTKKTKR
HHHHHHHCCCCCCCCEEEEEEECCCCEEEEEECCCCCCCCCCCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: DNA [C]

Specific reaction: Protein + DNA = Protein-DNA [C]

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 9163424 [H]