| Definition | Candidatus Solibacter usitatus Ellin6076 chromosome, complete genome. |
|---|---|
| Accession | NC_008536 |
| Length | 9,965,640 |
Click here to switch to the map view.
The map label for this gene is xerC [C]
Identifier: 116621639
GI number: 116621639
Start: 3196271
End: 3197629
Strand: Direct
Name: xerC [C]
Synonym: Acid_2521
Alternate gene names: 116621639
Gene position: 3196271-3197629 (Clockwise)
Preceding gene: 116621638
Following gene: 116621640
Centisome position: 32.07
GC content: 61.59
Gene sequence:
>1359_bases ATGCCAAATTGGCCGGACCAAGAAGACGAAACGCTGATCAACCAGTTCGTGGAACAGCTCAACCTGGTCTGCTATGGCGC GCCCTTCCTATCGCGGCTTCGCCAGTTCCAGCGCTTTGTCGCGCGGCGTTTTCCCAAGCGGGCGTTTTCTGAGGCGGTTC TCCGCGCCTGGTTGAAAGAAGAGTTGAAGACATCGCCCCTTCCCCTGGTAGTCCACCATGGACAGCTCGTGAACCGCTTT CTGGATTGGTTGGCCACGGGCGGAGCCATCGAGGCGAACCCGATTGCGGAACTGCGGCGCAAGTATGATTGCCGCTCGTC CGCGGCCGTGTTGCGAGCTCTCGCGGGTGATCAGTCAGGCAAGGCATTGGAGGCGCTTCGTCCGCCGCCACGATACGGCA GTCATCTGGGCCCGATTATGCGCGAGCATGTGAATCGCATGCGGACCCGCGGCCTCCGATACCGGCATGAAAACCGTTTT CTCCAGTTCGACCGGTTTCTACAGCAGCGGCCGGGCGCCGATAAGGAGCCGCTGACTACGTTGATCCGGGAATACGCCGG CCGCGCTTCTTCCGCAGCTGGCAAAGTGCAGCGCATCGATCTCGGCAGAGTGATTGCCAAGGAACTGAATCGCGGTGGGC TTTCCGTGGCGACGCCGAAACGCGACCGAGTGCTCGTGCAGGAGATGCTCAGAAGCCGCCGCCGGCCACATATCTACACT GGGGAGGAAGTCCGCCGGCTCTTGGATGCGGCACGCAGTGATCCGTCCCCGCGAGCGCCGCTGCGCCCGCTCACCTTGTA TACCATGCTGGTCCTTGCTTACTGCGCGGGATTGCGTCTGGCCGAGATCGTCGGGCTTAGACTTGGCGATCTGGACCTGA ACACGGATTGCATCGAGGTCGGCGACACGAAGTTCTTCAAGTCGCGGCGACTGCCATTGTCAGCTACCGCCATGGCCGCC CTGCGCGATTATCTCAATGCCCGCGCGAAAGCAGGCGCGCCTACCGAGTCCGACGCGCCGCTGTTCTGGCATGCGAAGGG CGGCTATGGTTATGTCGCCGCTGGGGCACATCTCCACCGGTTGATTCGAGTGGTCGGACTGAAGCGCGCTGGCGGCCACA CCGGCGCTCGCGTTCACGATCTACGCCATGCCTTTGTCGTCCACCGGATGACGAAGTGGTACGAGCAGGGGATCAACCCG CAGACCCGGTTGCCGTATCTGGCCGCCTACCTCGGCCACCGCAATATTCATTCCACCTTGGTCTATCTCACCATTACGCA GGAGCTGCTCCAGCATGCCAACGAGCGTTTCCGAACCTCGGAAGCCGAAGTCCTGCAAGTCATCCAGAGGTCTCATTAA
Upstream 100 bases:
>100_bases TGTTGGGCCATCGCTCGGCGGAATCTACCGAGATTTATCTGCGCCTCGCCACAGAGGATCTCCGGGCAATCAGTATCGAC TTGCCCGGGAAAGGAGAACC
Downstream 100 bases:
>100_bases TGCCGAAACACGATTTTCCTACGCTCCCGAAGTTACTGCACTCCTTCTTTCACGAATGGTTGGTCGAGCAGCGAAACGCC TCTCACCGGACGATACTGGC
Product: phage integrase family protein
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 452; Mature: 451
Protein sequence:
>452_residues MPNWPDQEDETLINQFVEQLNLVCYGAPFLSRLRQFQRFVARRFPKRAFSEAVLRAWLKEELKTSPLPLVVHHGQLVNRF LDWLATGGAIEANPIAELRRKYDCRSSAAVLRALAGDQSGKALEALRPPPRYGSHLGPIMREHVNRMRTRGLRYRHENRF LQFDRFLQQRPGADKEPLTTLIREYAGRASSAAGKVQRIDLGRVIAKELNRGGLSVATPKRDRVLVQEMLRSRRRPHIYT GEEVRRLLDAARSDPSPRAPLRPLTLYTMLVLAYCAGLRLAEIVGLRLGDLDLNTDCIEVGDTKFFKSRRLPLSATAMAA LRDYLNARAKAGAPTESDAPLFWHAKGGYGYVAAGAHLHRLIRVVGLKRAGGHTGARVHDLRHAFVVHRMTKWYEQGINP QTRLPYLAAYLGHRNIHSTLVYLTITQELLQHANERFRTSEAEVLQVIQRSH
Sequences:
>Translated_452_residues MPNWPDQEDETLINQFVEQLNLVCYGAPFLSRLRQFQRFVARRFPKRAFSEAVLRAWLKEELKTSPLPLVVHHGQLVNRF LDWLATGGAIEANPIAELRRKYDCRSSAAVLRALAGDQSGKALEALRPPPRYGSHLGPIMREHVNRMRTRGLRYRHENRF LQFDRFLQQRPGADKEPLTTLIREYAGRASSAAGKVQRIDLGRVIAKELNRGGLSVATPKRDRVLVQEMLRSRRRPHIYT GEEVRRLLDAARSDPSPRAPLRPLTLYTMLVLAYCAGLRLAEIVGLRLGDLDLNTDCIEVGDTKFFKSRRLPLSATAMAA LRDYLNARAKAGAPTESDAPLFWHAKGGYGYVAAGAHLHRLIRVVGLKRAGGHTGARVHDLRHAFVVHRMTKWYEQGINP QTRLPYLAAYLGHRNIHSTLVYLTITQELLQHANERFRTSEAEVLQVIQRSH >Mature_451_residues PNWPDQEDETLINQFVEQLNLVCYGAPFLSRLRQFQRFVARRFPKRAFSEAVLRAWLKEELKTSPLPLVVHHGQLVNRFL DWLATGGAIEANPIAELRRKYDCRSSAAVLRALAGDQSGKALEALRPPPRYGSHLGPIMREHVNRMRTRGLRYRHENRFL QFDRFLQQRPGADKEPLTTLIREYAGRASSAAGKVQRIDLGRVIAKELNRGGLSVATPKRDRVLVQEMLRSRRRPHIYTG EEVRRLLDAARSDPSPRAPLRPLTLYTMLVLAYCAGLRLAEIVGLRLGDLDLNTDCIEVGDTKFFKSRRLPLSATAMAAL RDYLNARAKAGAPTESDAPLFWHAKGGYGYVAAGAHLHRLIRVVGLKRAGGHTGARVHDLRHAFVVHRMTKWYEQGINPQ TRLPYLAAYLGHRNIHSTLVYLTITQELLQHANERFRTSEAEVLQVIQRSH
Specific function: Site-Specific Tyrosine Recombinase, Which Acts By Catalyzing The Cutting And Rejoining Of The Recombining DNA Molecules. Binds Cooperatively To Specific DNA Consensus Sequences That Are Separated From Xerd Binding Sites By A Short Central Region, Forming
COG id: COG0582
COG function: function code L; Integrase
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the 'phage' integrase family [H]
Homologues:
None
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR011010 - InterPro: IPR013762 - InterPro: IPR002104 [H]
Pfam domain/function: PF00589 Phage_integrase [H]
EC number: NA
Molecular weight: Translated: 51365; Mature: 51234
Theoretical pI: Translated: 10.92; Mature: 10.92
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.9 %Cys (Translated Protein) 1.5 %Met (Translated Protein) 2.4 %Cys+Met (Translated Protein) 0.9 %Cys (Mature Protein) 1.3 %Met (Mature Protein) 2.2 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MPNWPDQEDETLINQFVEQLNLVCYGAPFLSRLRQFQRFVARRFPKRAFSEAVLRAWLKE CCCCCCCHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHH ELKTSPLPLVVHHGQLVNRFLDWLATGGAIEANPIAELRRKYDCRSSAAVLRALAGDQSG HHCCCCCCEEEECHHHHHHHHHHHHCCCCCCCCHHHHHHHHHCCHHHHHHHHHHHCCCCC KALEALRPPPRYGSHLGPIMREHVNRMRTRGLRYRHENRFLQFDRFLQQRPGADKEPLTT CHHHHCCCCCCCCCHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHCCCCCCHHHHH LIREYAGRASSAAGKVQRIDLGRVIAKELNRGGLSVATPKRDRVLVQEMLRSRRRPHIYT HHHHHHCCCCHHCCCHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHCCCCCCCC GEEVRRLLDAARSDPSPRAPLRPLTLYTMLVLAYCAGLRLAEIVGLRLGDLDLNTDCIEV CHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHCCHHHHHHHHHCCCCCCCCCHHHC GDTKFFKSRRLPLSATAMAALRDYLNARAKAGAPTESDAPLFWHAKGGYGYVAAGAHLHR CCHHHHHHCCCCCHHHHHHHHHHHHHHHHCCCCCCCCCCCEEEEECCCCCEEHHHHHHHH LIRVVGLKRAGGHTGARVHDLRHAFVVHRMTKWYEQGINPQTRLPYLAAYLGHRNIHSTL HHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHCCCCHHHHH VYLTITQELLQHANERFRTSEAEVLQVIQRSH HHHHHHHHHHHHHHHHHCCCHHHHHHHHHHCC >Mature Secondary Structure PNWPDQEDETLINQFVEQLNLVCYGAPFLSRLRQFQRFVARRFPKRAFSEAVLRAWLKE CCCCCCHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHH ELKTSPLPLVVHHGQLVNRFLDWLATGGAIEANPIAELRRKYDCRSSAAVLRALAGDQSG HHCCCCCCEEEECHHHHHHHHHHHHCCCCCCCCHHHHHHHHHCCHHHHHHHHHHHCCCCC KALEALRPPPRYGSHLGPIMREHVNRMRTRGLRYRHENRFLQFDRFLQQRPGADKEPLTT CHHHHCCCCCCCCCHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHCCCCCCHHHHH LIREYAGRASSAAGKVQRIDLGRVIAKELNRGGLSVATPKRDRVLVQEMLRSRRRPHIYT HHHHHHCCCCHHCCCHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHCCCCCCCC GEEVRRLLDAARSDPSPRAPLRPLTLYTMLVLAYCAGLRLAEIVGLRLGDLDLNTDCIEV CHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHCCHHHHHHHHHCCCCCCCCCHHHC GDTKFFKSRRLPLSATAMAALRDYLNARAKAGAPTESDAPLFWHAKGGYGYVAAGAHLHR CCHHHHHHCCCCCHHHHHHHHHHHHHHHHCCCCCCCCCCCEEEEECCCCCEEHHHHHHHH LIRVVGLKRAGGHTGARVHDLRHAFVVHRMTKWYEQGINPQTRLPYLAAYLGHRNIHSTL HHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHCCCCHHHHH VYLTITQELLQHANERFRTSEAEVLQVIQRSH HHHHHHHHHHHHHHHHHCCCHHHHHHHHHHCC
PDB accession: NA
Resolution: NA
Structure class: Alpha
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: DNA [C]
Specific reaction: Protein + DNA = Protein-DNA [C]
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 9163424 [H]