Definition Xylella fastidiosa Temecula1, complete genome.
Accession NC_004556
Length 2,519,802

Click here to switch to the map view.

The map label for this gene is pkn1 [H]

Identifier: 77747717

GI number: 77747717

Start: 2232409

End: 2234019

Strand: Reverse

Name: pkn1 [H]

Synonym: PD1903

Alternate gene names: 77747717

Gene position: 2234019-2232409 (Counterclockwise)

Preceding gene: 28199774

Following gene: 77747716

Centisome position: 88.66

GC content: 58.66

Gene sequence:

>1611_bases
TTGGCTGAAGATCGACTGTACCGCAGCCCTGACGATGCGATTCCGCTGTATTTGGCATTGCGTGCCCGCAGTGACGGCCG
TGACCGTGTGGCTGAAGAAGGGCTGCGCCGTGCCTTGCTGCGTTTGCTGGTCCTGGCGGATGGCTTATTGCTGCAACCGC
AGGCACAGGAAGAAGCATTGGAACAAGCGGGCGATGTCACCATGGTGGCCTTGTCGCTGGCACCGCAGGATCCGCGAGTG
CATCGTTTGCAAAGTCGCGTTGAGACTGCACAACGTGTACTGGCCTTCAATCTTGCTGGTGAGGACGATTTGCGTGCTGG
AACGTTAGGCGAGAGTAGTCGCAGTGCATTGGATCACTTCCGCGATGCATTGGGCTTGGATCCGGACAATGCGCGTGCCC
GTCAAGGCTTGGCGGCAGTGGAGAGCGCGATGATCCGCTACGCAGAACAAGCGGCTGAGACCACTCATTTCGACAGTGCC
ACATACTGGCTTGATGTTGCATCCACGGTGCGCGAACAAGCACCTACGGTGATCGACGCGCGTAGGCGCATCGCTATCTT
GCGTATAGAAAAAATTGCCGCATTGCGGGATGCCGTATTGCGTGCAATTTCTGACCCAAAGAAATTAAAGAGCGCGCATG
CCCTCTTTACGGAGATTGTCCGTATTGCTGCTCCTGGTGATGCGGTGATTAGCGAGTTGCGGGAGCGCATCAATCGCGCA
ACCCATTATGGGAGCTTCCGCCGAGGACAAGTGTTTACCGATGCGATGCAAGACGGTACTCGAGGTCCCCAGATGCTGGT
GGTCCCCCACGGCAGCTTTCAGATGGGCGCAACCGATACCGAAGTAGGTGCCTCAGCGGCGGAACGACCGCAACACCATG
TCCGTTTTGAACGCGGTTTTGCGATGTCGATTACTGAAGTCACCGTCGCTCAGTTCCGGCGCTTTGTTGAGCAGACAGGT
TACCGACCGCGAGCAACCCGGCGAGGGCATTCACTGGTGTATGACGAACGCAGTGGGAACTTTGTGCGGCGCAGCGGCGT
AGATTGGCAGTCTGGTTACGATGGCCGCGCGGCTGCTCCCAACGATCCAGTGATGCATGTCAGCGTGCGCGATGCAGAGG
CGTATGCGGCATGGATGTCGCGTCAAACCGGGCGTTATTACCGCCTCCCAAGTGAAGCTGAGTTTGAGTACGCCCTGCGT
GCCGGCCGACAAGGCTACTACCCTTGGGGCAACGCCGCCGTCCCAGTGACCGGAAACTATACTGGCGGCAACGATGTCTC
TCCGAGTGGACGGCGTTGGGCCAATGCCTTTATCGGTTATGGGGATCGCTACTGGGCTGTGGCCCCTGTAGCTAGTTTCC
GCGCCAATGCCTGGGGCCTTCACGACATGGGCGGCAACTTGAGTGAATGGGTAGCCGATTGCTGGCACTCCAGTTATCGG
CGTGCCCCAGCCGATGGTGTCGCCTGGTACAACCCAGGCTGCCGTCAGCGTTTGGTACGTGGCGGCAGCTGGGCCAACTC
ACCACAGCAGACCCGTGCAGCGTGGCGTGGATCACAGGATTCAGAGATGACCAGCGCCAGGATTGGTTTCCGTCTCGTTC
GTGGCATATAA

Upstream 100 bases:

>100_bases
CACCAAAAAATCCGCCCCGACACGCGCGCTTTGGCAATCCCCACCGGTTGTATTAGGTGACATGACTTCCGTGCAGGTCA
GGCGGCGTGCTGCGCAGGCA

Downstream 100 bases:

>100_bases
CGTGCAGCTCTTTAGGGTAGAGGATCGTCACGGCGGGTGCTTGTCATGACGTCTTCCTCATAACATTCGGCGAAGACTGT
TTCGGCGAGGACTGTATGAA

Product: hypothetical protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 536; Mature: 535

Protein sequence:

>536_residues
MAEDRLYRSPDDAIPLYLALRARSDGRDRVAEEGLRRALLRLLVLADGLLLQPQAQEEALEQAGDVTMVALSLAPQDPRV
HRLQSRVETAQRVLAFNLAGEDDLRAGTLGESSRSALDHFRDALGLDPDNARARQGLAAVESAMIRYAEQAAETTHFDSA
TYWLDVASTVREQAPTVIDARRRIAILRIEKIAALRDAVLRAISDPKKLKSAHALFTEIVRIAAPGDAVISELRERINRA
THYGSFRRGQVFTDAMQDGTRGPQMLVVPHGSFQMGATDTEVGASAAERPQHHVRFERGFAMSITEVTVAQFRRFVEQTG
YRPRATRRGHSLVYDERSGNFVRRSGVDWQSGYDGRAAAPNDPVMHVSVRDAEAYAAWMSRQTGRYYRLPSEAEFEYALR
AGRQGYYPWGNAAVPVTGNYTGGNDVSPSGRRWANAFIGYGDRYWAVAPVASFRANAWGLHDMGGNLSEWVADCWHSSYR
RAPADGVAWYNPGCRQRLVRGGSWANSPQQTRAAWRGSQDSEMTSARIGFRLVRGI

Sequences:

>Translated_536_residues
MAEDRLYRSPDDAIPLYLALRARSDGRDRVAEEGLRRALLRLLVLADGLLLQPQAQEEALEQAGDVTMVALSLAPQDPRV
HRLQSRVETAQRVLAFNLAGEDDLRAGTLGESSRSALDHFRDALGLDPDNARARQGLAAVESAMIRYAEQAAETTHFDSA
TYWLDVASTVREQAPTVIDARRRIAILRIEKIAALRDAVLRAISDPKKLKSAHALFTEIVRIAAPGDAVISELRERINRA
THYGSFRRGQVFTDAMQDGTRGPQMLVVPHGSFQMGATDTEVGASAAERPQHHVRFERGFAMSITEVTVAQFRRFVEQTG
YRPRATRRGHSLVYDERSGNFVRRSGVDWQSGYDGRAAAPNDPVMHVSVRDAEAYAAWMSRQTGRYYRLPSEAEFEYALR
AGRQGYYPWGNAAVPVTGNYTGGNDVSPSGRRWANAFIGYGDRYWAVAPVASFRANAWGLHDMGGNLSEWVADCWHSSYR
RAPADGVAWYNPGCRQRLVRGGSWANSPQQTRAAWRGSQDSEMTSARIGFRLVRGI
>Mature_535_residues
AEDRLYRSPDDAIPLYLALRARSDGRDRVAEEGLRRALLRLLVLADGLLLQPQAQEEALEQAGDVTMVALSLAPQDPRVH
RLQSRVETAQRVLAFNLAGEDDLRAGTLGESSRSALDHFRDALGLDPDNARARQGLAAVESAMIRYAEQAAETTHFDSAT
YWLDVASTVREQAPTVIDARRRIAILRIEKIAALRDAVLRAISDPKKLKSAHALFTEIVRIAAPGDAVISELRERINRAT
HYGSFRRGQVFTDAMQDGTRGPQMLVVPHGSFQMGATDTEVGASAAERPQHHVRFERGFAMSITEVTVAQFRRFVEQTGY
RPRATRRGHSLVYDERSGNFVRRSGVDWQSGYDGRAAAPNDPVMHVSVRDAEAYAAWMSRQTGRYYRLPSEAEFEYALRA
GRQGYYPWGNAAVPVTGNYTGGNDVSPSGRRWANAFIGYGDRYWAVAPVASFRANAWGLHDMGGNLSEWVADCWHSSYRR
APADGVAWYNPGCRQRLVRGGSWANSPQQTRAAWRGSQDSEMTSARIGFRLVRGI

Specific function: Together with the serine/threonine kinase pknD, may play a role in the specific interactions with host proteins during intracellular growth [H]

COG id: COG1262

COG function: function code S; Uncharacterized conserved protein

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Contains 1 protein kinase domain [H]

Homologues:

Organism=Homo sapiens, GI38202250, Length=301, Percent_Identity=28.9036544850498, Blast_Score=103, Evalue=3e-22,
Organism=Homo sapiens, GI257470977, Length=238, Percent_Identity=30.672268907563, Blast_Score=100, Evalue=6e-21,
Organism=Homo sapiens, GI257470975, Length=286, Percent_Identity=29.020979020979, Blast_Score=96, Evalue=7e-20,
Organism=Homo sapiens, GI194248087, Length=283, Percent_Identity=31.095406360424, Blast_Score=92, Evalue=2e-18,
Organism=Homo sapiens, GI194248088, Length=293, Percent_Identity=30.7167235494881, Blast_Score=89, Evalue=1e-17,
Organism=Homo sapiens, GI226437577, Length=177, Percent_Identity=35.0282485875706, Blast_Score=74, Evalue=2e-13,
Organism=Homo sapiens, GI194248090, Length=175, Percent_Identity=33.7142857142857, Blast_Score=68, Evalue=2e-11,
Organism=Drosophila melanogaster, GI20130397, Length=301, Percent_Identity=29.2358803986711, Blast_Score=92, Evalue=9e-19,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR016187
- InterPro:   IPR011009
- InterPro:   IPR000719
- InterPro:   IPR017442
- InterPro:   IPR005532 [H]

Pfam domain/function: PF03781 DUF323; PF00069 Pkinase [H]

EC number: =2.7.11.1 [H]

Molecular weight: Translated: 59564; Mature: 59433

Theoretical pI: Translated: 9.53; Mature: 9.53

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.4 %Cys     (Translated Protein)
2.1 %Met     (Translated Protein)
2.4 %Cys+Met (Translated Protein)
0.4 %Cys     (Mature Protein)
1.9 %Met     (Mature Protein)
2.2 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MAEDRLYRSPDDAIPLYLALRARSDGRDRVAEEGLRRALLRLLVLADGLLLQPQAQEEAL
CCCCCCCCCCCCCCEEEEEEECCCCCHHHHHHHHHHHHHHHHHHHHCCCEECCCHHHHHH
EQAGDVTMVALSLAPQDPRVHRLQSRVETAQRVLAFNLAGEDDLRAGTLGESSRSALDHF
HHCCCEEEEEEEECCCCCHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCHHHHHHHHH
RDALGLDPDNARARQGLAAVESAMIRYAEQAAETTHFDSATYWLDVASTVREQAPTVIDA
HHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHCCHHHHH
RRRIAILRIEKIAALRDAVLRAISDPKKLKSAHALFTEIVRIAAPGDAVISELRERINRA
HHHEEHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHH
THYGSFRRGQVFTDAMQDGTRGPQMLVVPHGSFQMGATDTEVGASAAERPQHHVRFERGF
HHCCCCCCCCHHHHHHHCCCCCCEEEEEECCCEECCCCCHHHCCHHHHCCHHHHHHHCCC
AMSITEVTVAQFRRFVEQTGYRPRATRRGHSLVYDERSGNFVRRSGVDWQSGYDGRAAAP
EEHHHHHHHHHHHHHHHHCCCCCCCCCCCCCEEEECCCCCEEEECCCCCCCCCCCCCCCC
NDPVMHVSVRDAEAYAAWMSRQTGRYYRLPSEAEFEYALRAGRQGYYPWGNAAVPVTGNY
CCCEEEEEECCHHHHHHHHHHCCCCEEECCCCCHHHHHHHCCCCCCCCCCCEEEEEECCC
TGGNDVSPSGRRWANAFIGYGDRYWAVAPVASFRANAWGLHDMGGNLSEWVADCWHSSYR
CCCCCCCCCCHHHHHHHHCCCCCEEEECCHHHHCCCCCCCHHCCCCHHHHHHHHHHHHHC
RAPADGVAWYNPGCRQRLVRGGSWANSPQQTRAAWRGSQDSEMTSARIGFRLVRGI
CCCCCCCCCCCCCHHHHHHCCCCCCCCHHHHHHHHCCCCCHHHHHHHHHHHHHCCC
>Mature Secondary Structure 
AEDRLYRSPDDAIPLYLALRARSDGRDRVAEEGLRRALLRLLVLADGLLLQPQAQEEAL
CCCCCCCCCCCCCEEEEEEECCCCCHHHHHHHHHHHHHHHHHHHHCCCEECCCHHHHHH
EQAGDVTMVALSLAPQDPRVHRLQSRVETAQRVLAFNLAGEDDLRAGTLGESSRSALDHF
HHCCCEEEEEEEECCCCCHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCHHHHHHHHH
RDALGLDPDNARARQGLAAVESAMIRYAEQAAETTHFDSATYWLDVASTVREQAPTVIDA
HHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHCCHHHHH
RRRIAILRIEKIAALRDAVLRAISDPKKLKSAHALFTEIVRIAAPGDAVISELRERINRA
HHHEEHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHH
THYGSFRRGQVFTDAMQDGTRGPQMLVVPHGSFQMGATDTEVGASAAERPQHHVRFERGF
HHCCCCCCCCHHHHHHHCCCCCCEEEEEECCCEECCCCCHHHCCHHHHCCHHHHHHHCCC
AMSITEVTVAQFRRFVEQTGYRPRATRRGHSLVYDERSGNFVRRSGVDWQSGYDGRAAAP
EEHHHHHHHHHHHHHHHHCCCCCCCCCCCCCEEEECCCCCEEEECCCCCCCCCCCCCCCC
NDPVMHVSVRDAEAYAAWMSRQTGRYYRLPSEAEFEYALRAGRQGYYPWGNAAVPVTGNY
CCCEEEEEECCHHHHHHHHHHCCCCEEECCCCCHHHHHHHCCCCCCCCCCCEEEEEECCC
TGGNDVSPSGRRWANAFIGYGDRYWAVAPVASFRANAWGLHDMGGNLSEWVADCWHSSYR
CCCCCCCCCCHHHHHHHHCCCCCEEEECCHHHHCCCCCCCHHCCCCHHHHHHHHHHHHHC
RAPADGVAWYNPGCRQRLVRGGSWANSPQQTRAAWRGSQDSEMTSARIGFRLVRGI
CCCCCCCCCCCCCHHHHHHCCCCCCCCHHHHHHHHCCCCCHHHHHHHHHHHHHCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 10684935 [H]