Definition Polaromonas sp. JS666 chromosome, complete genome.
Accession NC_007948
Length 5,200,264

Click here to switch to the map view.

The map label for this gene is 91787830

Identifier: 91787830

GI number: 91787830

Start: 2018946

End: 2020934

Strand: Reverse

Name: 91787830

Synonym: Bpro_1953

Alternate gene names: NA

Gene position: 2020934-2018946 (Counterclockwise)

Preceding gene: 91787836

Following gene: 91787824

Centisome position: 38.86

GC content: 55.86

Gene sequence:

>1989_bases
GTGTCGGGAGCTCAGTACCTATATCGCCGCGACAGCGGCACTTACTATATTCGCCTTTGCGTGCCAGCGCGTTTGAAGGT
GGCGGTCGGCAAAGGTGAAATCCATCGAACCACGGGCTGCCGGGATTACCGGCTTGCCAAGATCGTGGCAGCCGAACTTG
CCGCACACTGGCACCGGGCGATTCAAGCGCTGGAACGCATGGACATCTCGAAGATCAAGGCCGGATCCATCAAGCTGCTT
GGTGACGGTTACATCCCGTTAACCGATGCGGCTGAGGCGTTAGGCACCACCCCCTCATCTCTTGCCCAACGGCTTACCAT
CCGCCAGGCTCATTTCTTTGTCGAGGCGAACGACTGGCTCGGCTGGGCGGTAGAAGACATCCACGAGTCTCTGGAGCACA
TCCAGGACGAGCTTGGACAGGTCGAGGTCGTCATCGATGCGAACAAGATGGGCGGGCCGGCAGCACAGCGTCGGTTCAGT
GGCCTGCTCCGGATCCGCTTTCCTGAAGAAGTGATCGCGATGGTGCGCACCAATCAACCGGCTGGACTGTGTCAGTTCCT
GCTGTGGCCATCCCCCGATCGTGGTTTTGTATGCGACCTACCAGGCCAGCCGGTTGACAGCCAGATGTTGCAGATCCGCC
GGATCGATGTTGAGGCCATGCGCCTGGACCTGGCGGCACAGCTCACCCCGGATATGCTGGCCTCGGCACATCCAACCCTG
CCCCAGCCGGACACAACGACCACCCTACCCACGCCTTCAACGGGTATGACCTTTTTGGTGTTCCGCGATGAATATTTGAA
ACGCAACGCGGGCTTCTGGAAGGCCGACCAGGTGCGCCGACGCCAGGACCAGTTTGAGGCATTTCTTGAACTGATGGGGG
ATCTTCAACTCGCCAAAATAGACCGGGCCACGATACGGACATTTTCAGACGAGATCGCAAAAATTCCCGATGAGCGACAT
AACGTTCGCCGTAAATTCAAGCGCCCCGACGCAGACTATCAAGAATTGATCGAGCTGGCCGAAAAACACAACTTGCCCAG
GTTAACGGTCTCTGCTCAGCAACGGATGCTCGATGGAATTTCGGAAATTTTCGCGTGGGCTGAACGAGAAACGCTAATCA
CCAGCAATCCAGCCAAGGGGCTCGGCGGTGAACTGAAAAAACGCTCAGGAAGCACCAAGGTCAAAGCGCATGAGCAACGC
GACCCGCTCTCCGACGTGGACCTTCAGAAGATATTTTCTGCAGTCTGGTTCACCACGGGAAGCGGCCTAAAAACTGCCAA
AGGCAAGTTCTACACCTACAGGCCGCATTACTTCTGGCTGCCCTTGCTCGCCATCTATCACGGTGGGCGACTGAATGAGC
TGTCACAACTCTACCTCGACGACATCAAGACAAGTGAAAGCGGCGTTCCTTATCTCGACTTTAATTTGTTGGGCGAAGAC
AAGATGGACGTCGACGAAGCAGACCGGAGCGCCGCCACCGACAAGTCATTAAAAACAGTGAGTTCGCAGCGCGTAGTCCC
CATGCACAAGCACCTGGTGGACCTGGGCTTCCGGGAATATGTGAGTGCATTGCGGGACGCCGGCTACAAGCGACTTTTCC
CGGAGTTGCGTTTTAACAAGGCTAAGGGCTACGGCAAGGCGGCCGGGAGCTGGTTCAACGAGCGTTTTCTCGGCAAAGAA
CTCGGTATCCCAAGAAATGGACGTAAGACGTTTCATTCGATGCGCCACAACTTTGCCACAGCACTGGGCGCCACTGCTAC
GCCTACCACCATAAAGTCTGACCTAATGGGACATTCCCGCGGGCTTGCACTGGTAGAGGCCCGCTACGACAAGGGAGGAG
ATTTGCTTGAGCGAAAAAAAGTCATTGACGCAATTCAATACGCCTTGCCGCCCATTGCCCACTTCAATATCAAAGACGGA
ATCCAGGCGATCAAGGACGCATTGAAGACAAAGGAATCCCACAAAAAAACGAAGAGGTATCCGTCCTGA

Upstream 100 bases:

>100_bases
CCCTTCACCCGCTCCATAGTTTCGTAAGCTATTGATCTTGCTTATGATTCTGTGAGGCTGACACGCCGCTTGCAGGTCTA
CTACGAAAGTGGGGACCAAA

Downstream 100 bases:

>100_bases
AAGGCCGCCGCCGTCAAGGCCTGCGGGTGGTCATGCCAGCAGTTCCTCTTGTCGCTGAACTTTGAGGACGCGCAGTTGTC
TGTTCTTCTGTCCGGCTACC

Product: putative integrase

Products: NA

Alternate protein names: Integrase; Phage-Related Integrase; Phage Integrase; Phage Integrase Family Protein; Phage Integrase Family Site Specific Recombinase; Site-Specific Recombinase Phage Integrase Family; Site-Specific Recombinase; Phage Integerase; DNA-Binfing Protein; Integrase/Resolvase Recombinase Protein

Number of amino acids: Translated: 662; Mature: 661

Protein sequence:

>662_residues
MSGAQYLYRRDSGTYYIRLCVPARLKVAVGKGEIHRTTGCRDYRLAKIVAAELAAHWHRAIQALERMDISKIKAGSIKLL
GDGYIPLTDAAEALGTTPSSLAQRLTIRQAHFFVEANDWLGWAVEDIHESLEHIQDELGQVEVVIDANKMGGPAAQRRFS
GLLRIRFPEEVIAMVRTNQPAGLCQFLLWPSPDRGFVCDLPGQPVDSQMLQIRRIDVEAMRLDLAAQLTPDMLASAHPTL
PQPDTTTTLPTPSTGMTFLVFRDEYLKRNAGFWKADQVRRRQDQFEAFLELMGDLQLAKIDRATIRTFSDEIAKIPDERH
NVRRKFKRPDADYQELIELAEKHNLPRLTVSAQQRMLDGISEIFAWAERETLITSNPAKGLGGELKKRSGSTKVKAHEQR
DPLSDVDLQKIFSAVWFTTGSGLKTAKGKFYTYRPHYFWLPLLAIYHGGRLNELSQLYLDDIKTSESGVPYLDFNLLGED
KMDVDEADRSAATDKSLKTVSSQRVVPMHKHLVDLGFREYVSALRDAGYKRLFPELRFNKAKGYGKAAGSWFNERFLGKE
LGIPRNGRKTFHSMRHNFATALGATATPTTIKSDLMGHSRGLALVEARYDKGGDLLERKKVIDAIQYALPPIAHFNIKDG
IQAIKDALKTKESHKKTKRYPS

Sequences:

>Translated_662_residues
MSGAQYLYRRDSGTYYIRLCVPARLKVAVGKGEIHRTTGCRDYRLAKIVAAELAAHWHRAIQALERMDISKIKAGSIKLL
GDGYIPLTDAAEALGTTPSSLAQRLTIRQAHFFVEANDWLGWAVEDIHESLEHIQDELGQVEVVIDANKMGGPAAQRRFS
GLLRIRFPEEVIAMVRTNQPAGLCQFLLWPSPDRGFVCDLPGQPVDSQMLQIRRIDVEAMRLDLAAQLTPDMLASAHPTL
PQPDTTTTLPTPSTGMTFLVFRDEYLKRNAGFWKADQVRRRQDQFEAFLELMGDLQLAKIDRATIRTFSDEIAKIPDERH
NVRRKFKRPDADYQELIELAEKHNLPRLTVSAQQRMLDGISEIFAWAERETLITSNPAKGLGGELKKRSGSTKVKAHEQR
DPLSDVDLQKIFSAVWFTTGSGLKTAKGKFYTYRPHYFWLPLLAIYHGGRLNELSQLYLDDIKTSESGVPYLDFNLLGED
KMDVDEADRSAATDKSLKTVSSQRVVPMHKHLVDLGFREYVSALRDAGYKRLFPELRFNKAKGYGKAAGSWFNERFLGKE
LGIPRNGRKTFHSMRHNFATALGATATPTTIKSDLMGHSRGLALVEARYDKGGDLLERKKVIDAIQYALPPIAHFNIKDG
IQAIKDALKTKESHKKTKRYPS
>Mature_661_residues
SGAQYLYRRDSGTYYIRLCVPARLKVAVGKGEIHRTTGCRDYRLAKIVAAELAAHWHRAIQALERMDISKIKAGSIKLLG
DGYIPLTDAAEALGTTPSSLAQRLTIRQAHFFVEANDWLGWAVEDIHESLEHIQDELGQVEVVIDANKMGGPAAQRRFSG
LLRIRFPEEVIAMVRTNQPAGLCQFLLWPSPDRGFVCDLPGQPVDSQMLQIRRIDVEAMRLDLAAQLTPDMLASAHPTLP
QPDTTTTLPTPSTGMTFLVFRDEYLKRNAGFWKADQVRRRQDQFEAFLELMGDLQLAKIDRATIRTFSDEIAKIPDERHN
VRRKFKRPDADYQELIELAEKHNLPRLTVSAQQRMLDGISEIFAWAERETLITSNPAKGLGGELKKRSGSTKVKAHEQRD
PLSDVDLQKIFSAVWFTTGSGLKTAKGKFYTYRPHYFWLPLLAIYHGGRLNELSQLYLDDIKTSESGVPYLDFNLLGEDK
MDVDEADRSAATDKSLKTVSSQRVVPMHKHLVDLGFREYVSALRDAGYKRLFPELRFNKAKGYGKAAGSWFNERFLGKEL
GIPRNGRKTFHSMRHNFATALGATATPTTIKSDLMGHSRGLALVEARYDKGGDLLERKKVIDAIQYALPPIAHFNIKDGI
QAIKDALKTKESHKKTKRYPS

Specific function: Unknown

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 74661; Mature: 74530

Theoretical pI: Translated: 9.77; Mature: 9.77

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.6 %Cys     (Translated Protein)
2.1 %Met     (Translated Protein)
2.7 %Cys+Met (Translated Protein)
0.6 %Cys     (Mature Protein)
2.0 %Met     (Mature Protein)
2.6 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSGAQYLYRRDSGTYYIRLCVPARLKVAVGKGEIHRTTGCRDYRLAKIVAAELAAHWHRA
CCCCCEEEEECCCCEEEEEEECCEEEEEECCCCEEECCCCCHHHHHHHHHHHHHHHHHHH
IQALERMDISKIKAGSIKLLGDGYIPLTDAAEALGTTPSSLAQRLTIRQAHFFVEANDWL
HHHHHHCCHHHCCCCCEEEEECCCCCHHHHHHHHCCCHHHHHHHHHHHHHEEEEEECCCC
GWAVEDIHESLEHIQDELGQVEVVIDANKMGGPAAQRRFSGLLRIRFPEEVIAMVRTNQP
HHHHHHHHHHHHHHHHHCCCEEEEEECCCCCCHHHHHHHCCEEEEECHHHHHHHHHCCCC
AGLCQFLLWPSPDRGFVCDLPGQPVDSQMLQIRRIDVEAMRLDLAAQLTPDMLASAHPTL
HHHHHHEECCCCCCCEEECCCCCCCCHHHHHHHHHHHHHHHHHHHHHCCHHHHHCCCCCC
PQPDTTTTLPTPSTGMTFLVFRDEYLKRNAGFWKADQVRRRQDQFEAFLELMGDLQLAKI
CCCCCCCCCCCCCCCCEEEEEEHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHCCCHHHHH
DRATIRTFSDEIAKIPDERHNVRRKFKRPDADYQELIELAEKHNLPRLTVSAQQRMLDGI
HHHHHHHHHHHHHHCCCHHHHHHHHHCCCCCCHHHHHHHHHHCCCCEEEHHHHHHHHHHH
SEIFAWAERETLITSNPAKGLGGELKKRSGSTKVKAHEQRDPLSDVDLQKIFSAVWFTTG
HHHHHHHHCCEEEECCCCCCCCCHHHHCCCCCCEEECCCCCCCCCCCHHHHHHHHHHCCC
SGLKTAKGKFYTYRPHYFWLPLLAIYHGGRLNELSQLYLDDIKTSESGVPYLDFNLLGED
CCCCCCCCCEEEECCCHHHHHHHHHHCCCCHHHHHHHHHHHHCCCCCCCCEEEEEECCCC
KMDVDEADRSAATDKSLKTVSSQRVVPMHKHLVDLGFREYVSALRDAGYKRLFPELRFNK
CCCCCHHHHHHHHHHHHHHHHCCCCCHHHHHHHHCCHHHHHHHHHHCCHHHHCHHHHHHC
AKGYGKAAGSWFNERFLGKELGIPRNGRKTFHSMRHNFATALGATATPTTIKSDLMGHSR
CCCCCCHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHCCCCCCHHHHHHHHCCCC
GLALVEARYDKGGDLLERKKVIDAIQYALPPIAHFNIKDGIQAIKDALKTKESHKKTKRY
CEEEEEECCCCCCHHHHHHHHHHHHHHHCCCCEECCHHHHHHHHHHHHHHHHHHHHHCCC
PS
CC
>Mature Secondary Structure 
SGAQYLYRRDSGTYYIRLCVPARLKVAVGKGEIHRTTGCRDYRLAKIVAAELAAHWHRA
CCCCEEEEECCCCEEEEEEECCEEEEEECCCCEEECCCCCHHHHHHHHHHHHHHHHHHH
IQALERMDISKIKAGSIKLLGDGYIPLTDAAEALGTTPSSLAQRLTIRQAHFFVEANDWL
HHHHHHCCHHHCCCCCEEEEECCCCCHHHHHHHHCCCHHHHHHHHHHHHHEEEEEECCCC
GWAVEDIHESLEHIQDELGQVEVVIDANKMGGPAAQRRFSGLLRIRFPEEVIAMVRTNQP
HHHHHHHHHHHHHHHHHCCCEEEEEECCCCCCHHHHHHHCCEEEEECHHHHHHHHHCCCC
AGLCQFLLWPSPDRGFVCDLPGQPVDSQMLQIRRIDVEAMRLDLAAQLTPDMLASAHPTL
HHHHHHEECCCCCCCEEECCCCCCCCHHHHHHHHHHHHHHHHHHHHHCCHHHHHCCCCCC
PQPDTTTTLPTPSTGMTFLVFRDEYLKRNAGFWKADQVRRRQDQFEAFLELMGDLQLAKI
CCCCCCCCCCCCCCCCEEEEEEHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHCCCHHHHH
DRATIRTFSDEIAKIPDERHNVRRKFKRPDADYQELIELAEKHNLPRLTVSAQQRMLDGI
HHHHHHHHHHHHHHCCCHHHHHHHHHCCCCCCHHHHHHHHHHCCCCEEEHHHHHHHHHHH
SEIFAWAERETLITSNPAKGLGGELKKRSGSTKVKAHEQRDPLSDVDLQKIFSAVWFTTG
HHHHHHHHCCEEEECCCCCCCCCHHHHCCCCCCEEECCCCCCCCCCCHHHHHHHHHHCCC
SGLKTAKGKFYTYRPHYFWLPLLAIYHGGRLNELSQLYLDDIKTSESGVPYLDFNLLGED
CCCCCCCCCEEEECCCHHHHHHHHHHCCCCHHHHHHHHHHHHCCCCCCCCEEEEEECCCC
KMDVDEADRSAATDKSLKTVSSQRVVPMHKHLVDLGFREYVSALRDAGYKRLFPELRFNK
CCCCCHHHHHHHHHHHHHHHHCCCCCHHHHHHHHCCHHHHHHHHHHCCHHHHCHHHHHHC
AKGYGKAAGSWFNERFLGKELGIPRNGRKTFHSMRHNFATALGATATPTTIKSDLMGHSR
CCCCCCHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHCCCCCCHHHHHHHHCCCC
GLALVEARYDKGGDLLERKKVIDAIQYALPPIAHFNIKDGIQAIKDALKTKESHKKTKRY
CEEEEEECCCCCCHHHHHHHHHHHHHHHCCCCEECCHHHHHHHHHHHHHHHHHHHHHCCC
PS
CC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA