Definition Candidatus Solibacter usitatus Ellin6076 chromosome, complete genome.
Accession NC_008536
Length 9,965,640

Click here to switch to the map view.

The map label for this gene is xerC [C]

Identifier: 116621639

GI number: 116621639

Start: 3196271

End: 3197629

Strand: Direct

Name: xerC [C]

Synonym: Acid_2521

Alternate gene names: 116621639

Gene position: 3196271-3197629 (Clockwise)

Preceding gene: 116621638

Following gene: 116621640

Centisome position: 32.07

GC content: 61.59

Gene sequence:

>1359_bases
ATGCCAAATTGGCCGGACCAAGAAGACGAAACGCTGATCAACCAGTTCGTGGAACAGCTCAACCTGGTCTGCTATGGCGC
GCCCTTCCTATCGCGGCTTCGCCAGTTCCAGCGCTTTGTCGCGCGGCGTTTTCCCAAGCGGGCGTTTTCTGAGGCGGTTC
TCCGCGCCTGGTTGAAAGAAGAGTTGAAGACATCGCCCCTTCCCCTGGTAGTCCACCATGGACAGCTCGTGAACCGCTTT
CTGGATTGGTTGGCCACGGGCGGAGCCATCGAGGCGAACCCGATTGCGGAACTGCGGCGCAAGTATGATTGCCGCTCGTC
CGCGGCCGTGTTGCGAGCTCTCGCGGGTGATCAGTCAGGCAAGGCATTGGAGGCGCTTCGTCCGCCGCCACGATACGGCA
GTCATCTGGGCCCGATTATGCGCGAGCATGTGAATCGCATGCGGACCCGCGGCCTCCGATACCGGCATGAAAACCGTTTT
CTCCAGTTCGACCGGTTTCTACAGCAGCGGCCGGGCGCCGATAAGGAGCCGCTGACTACGTTGATCCGGGAATACGCCGG
CCGCGCTTCTTCCGCAGCTGGCAAAGTGCAGCGCATCGATCTCGGCAGAGTGATTGCCAAGGAACTGAATCGCGGTGGGC
TTTCCGTGGCGACGCCGAAACGCGACCGAGTGCTCGTGCAGGAGATGCTCAGAAGCCGCCGCCGGCCACATATCTACACT
GGGGAGGAAGTCCGCCGGCTCTTGGATGCGGCACGCAGTGATCCGTCCCCGCGAGCGCCGCTGCGCCCGCTCACCTTGTA
TACCATGCTGGTCCTTGCTTACTGCGCGGGATTGCGTCTGGCCGAGATCGTCGGGCTTAGACTTGGCGATCTGGACCTGA
ACACGGATTGCATCGAGGTCGGCGACACGAAGTTCTTCAAGTCGCGGCGACTGCCATTGTCAGCTACCGCCATGGCCGCC
CTGCGCGATTATCTCAATGCCCGCGCGAAAGCAGGCGCGCCTACCGAGTCCGACGCGCCGCTGTTCTGGCATGCGAAGGG
CGGCTATGGTTATGTCGCCGCTGGGGCACATCTCCACCGGTTGATTCGAGTGGTCGGACTGAAGCGCGCTGGCGGCCACA
CCGGCGCTCGCGTTCACGATCTACGCCATGCCTTTGTCGTCCACCGGATGACGAAGTGGTACGAGCAGGGGATCAACCCG
CAGACCCGGTTGCCGTATCTGGCCGCCTACCTCGGCCACCGCAATATTCATTCCACCTTGGTCTATCTCACCATTACGCA
GGAGCTGCTCCAGCATGCCAACGAGCGTTTCCGAACCTCGGAAGCCGAAGTCCTGCAAGTCATCCAGAGGTCTCATTAA

Upstream 100 bases:

>100_bases
TGTTGGGCCATCGCTCGGCGGAATCTACCGAGATTTATCTGCGCCTCGCCACAGAGGATCTCCGGGCAATCAGTATCGAC
TTGCCCGGGAAAGGAGAACC

Downstream 100 bases:

>100_bases
TGCCGAAACACGATTTTCCTACGCTCCCGAAGTTACTGCACTCCTTCTTTCACGAATGGTTGGTCGAGCAGCGAAACGCC
TCTCACCGGACGATACTGGC

Product: phage integrase family protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 452; Mature: 451

Protein sequence:

>452_residues
MPNWPDQEDETLINQFVEQLNLVCYGAPFLSRLRQFQRFVARRFPKRAFSEAVLRAWLKEELKTSPLPLVVHHGQLVNRF
LDWLATGGAIEANPIAELRRKYDCRSSAAVLRALAGDQSGKALEALRPPPRYGSHLGPIMREHVNRMRTRGLRYRHENRF
LQFDRFLQQRPGADKEPLTTLIREYAGRASSAAGKVQRIDLGRVIAKELNRGGLSVATPKRDRVLVQEMLRSRRRPHIYT
GEEVRRLLDAARSDPSPRAPLRPLTLYTMLVLAYCAGLRLAEIVGLRLGDLDLNTDCIEVGDTKFFKSRRLPLSATAMAA
LRDYLNARAKAGAPTESDAPLFWHAKGGYGYVAAGAHLHRLIRVVGLKRAGGHTGARVHDLRHAFVVHRMTKWYEQGINP
QTRLPYLAAYLGHRNIHSTLVYLTITQELLQHANERFRTSEAEVLQVIQRSH

Sequences:

>Translated_452_residues
MPNWPDQEDETLINQFVEQLNLVCYGAPFLSRLRQFQRFVARRFPKRAFSEAVLRAWLKEELKTSPLPLVVHHGQLVNRF
LDWLATGGAIEANPIAELRRKYDCRSSAAVLRALAGDQSGKALEALRPPPRYGSHLGPIMREHVNRMRTRGLRYRHENRF
LQFDRFLQQRPGADKEPLTTLIREYAGRASSAAGKVQRIDLGRVIAKELNRGGLSVATPKRDRVLVQEMLRSRRRPHIYT
GEEVRRLLDAARSDPSPRAPLRPLTLYTMLVLAYCAGLRLAEIVGLRLGDLDLNTDCIEVGDTKFFKSRRLPLSATAMAA
LRDYLNARAKAGAPTESDAPLFWHAKGGYGYVAAGAHLHRLIRVVGLKRAGGHTGARVHDLRHAFVVHRMTKWYEQGINP
QTRLPYLAAYLGHRNIHSTLVYLTITQELLQHANERFRTSEAEVLQVIQRSH
>Mature_451_residues
PNWPDQEDETLINQFVEQLNLVCYGAPFLSRLRQFQRFVARRFPKRAFSEAVLRAWLKEELKTSPLPLVVHHGQLVNRFL
DWLATGGAIEANPIAELRRKYDCRSSAAVLRALAGDQSGKALEALRPPPRYGSHLGPIMREHVNRMRTRGLRYRHENRFL
QFDRFLQQRPGADKEPLTTLIREYAGRASSAAGKVQRIDLGRVIAKELNRGGLSVATPKRDRVLVQEMLRSRRRPHIYTG
EEVRRLLDAARSDPSPRAPLRPLTLYTMLVLAYCAGLRLAEIVGLRLGDLDLNTDCIEVGDTKFFKSRRLPLSATAMAAL
RDYLNARAKAGAPTESDAPLFWHAKGGYGYVAAGAHLHRLIRVVGLKRAGGHTGARVHDLRHAFVVHRMTKWYEQGINPQ
TRLPYLAAYLGHRNIHSTLVYLTITQELLQHANERFRTSEAEVLQVIQRSH

Specific function: Site-Specific Tyrosine Recombinase, Which Acts By Catalyzing The Cutting And Rejoining Of The Recombining DNA Molecules. Binds Cooperatively To Specific DNA Consensus Sequences That Are Separated From Xerd Binding Sites By A Short Central Region, Forming

COG id: COG0582

COG function: function code L; Integrase

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the 'phage' integrase family [H]

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR011010
- InterPro:   IPR013762
- InterPro:   IPR002104 [H]

Pfam domain/function: PF00589 Phage_integrase [H]

EC number: NA

Molecular weight: Translated: 51365; Mature: 51234

Theoretical pI: Translated: 10.92; Mature: 10.92

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.9 %Cys     (Translated Protein)
1.5 %Met     (Translated Protein)
2.4 %Cys+Met (Translated Protein)
0.9 %Cys     (Mature Protein)
1.3 %Met     (Mature Protein)
2.2 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MPNWPDQEDETLINQFVEQLNLVCYGAPFLSRLRQFQRFVARRFPKRAFSEAVLRAWLKE
CCCCCCCHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHH
ELKTSPLPLVVHHGQLVNRFLDWLATGGAIEANPIAELRRKYDCRSSAAVLRALAGDQSG
HHCCCCCCEEEECHHHHHHHHHHHHCCCCCCCCHHHHHHHHHCCHHHHHHHHHHHCCCCC
KALEALRPPPRYGSHLGPIMREHVNRMRTRGLRYRHENRFLQFDRFLQQRPGADKEPLTT
CHHHHCCCCCCCCCHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHCCCCCCHHHHH
LIREYAGRASSAAGKVQRIDLGRVIAKELNRGGLSVATPKRDRVLVQEMLRSRRRPHIYT
HHHHHHCCCCHHCCCHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHCCCCCCCC
GEEVRRLLDAARSDPSPRAPLRPLTLYTMLVLAYCAGLRLAEIVGLRLGDLDLNTDCIEV
CHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHCCHHHHHHHHHCCCCCCCCCHHHC
GDTKFFKSRRLPLSATAMAALRDYLNARAKAGAPTESDAPLFWHAKGGYGYVAAGAHLHR
CCHHHHHHCCCCCHHHHHHHHHHHHHHHHCCCCCCCCCCCEEEEECCCCCEEHHHHHHHH
LIRVVGLKRAGGHTGARVHDLRHAFVVHRMTKWYEQGINPQTRLPYLAAYLGHRNIHSTL
HHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHCCCCHHHHH
VYLTITQELLQHANERFRTSEAEVLQVIQRSH
HHHHHHHHHHHHHHHHHCCCHHHHHHHHHHCC
>Mature Secondary Structure 
PNWPDQEDETLINQFVEQLNLVCYGAPFLSRLRQFQRFVARRFPKRAFSEAVLRAWLKE
CCCCCCHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHH
ELKTSPLPLVVHHGQLVNRFLDWLATGGAIEANPIAELRRKYDCRSSAAVLRALAGDQSG
HHCCCCCCEEEECHHHHHHHHHHHHCCCCCCCCHHHHHHHHHCCHHHHHHHHHHHCCCCC
KALEALRPPPRYGSHLGPIMREHVNRMRTRGLRYRHENRFLQFDRFLQQRPGADKEPLTT
CHHHHCCCCCCCCCHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHCCCCCCHHHHH
LIREYAGRASSAAGKVQRIDLGRVIAKELNRGGLSVATPKRDRVLVQEMLRSRRRPHIYT
HHHHHHCCCCHHCCCHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHCCCCCCCC
GEEVRRLLDAARSDPSPRAPLRPLTLYTMLVLAYCAGLRLAEIVGLRLGDLDLNTDCIEV
CHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHCCHHHHHHHHHCCCCCCCCCHHHC
GDTKFFKSRRLPLSATAMAALRDYLNARAKAGAPTESDAPLFWHAKGGYGYVAAGAHLHR
CCHHHHHHCCCCCHHHHHHHHHHHHHHHHCCCCCCCCCCCEEEEECCCCCEEHHHHHHHH
LIRVVGLKRAGGHTGARVHDLRHAFVVHRMTKWYEQGINPQTRLPYLAAYLGHRNIHSTL
HHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHCCCCHHHHH
VYLTITQELLQHANERFRTSEAEVLQVIQRSH
HHHHHHHHHHHHHHHHHCCCHHHHHHHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Alpha

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: DNA [C]

Specific reaction: Protein + DNA = Protein-DNA [C]

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 9163424 [H]