Definition Xylella fastidiosa M23 chromosome, complete genome.
Accession NC_010577
Length 2,535,690

Click here to switch to the map view.

The map label for this gene is 182681549

Identifier: 182681549

GI number: 182681549

Start: 1161601

End: 1164330

Strand: Reverse

Name: 182681549

Synonym: XfasM23_1004

Alternate gene names: NA

Gene position: 1164330-1161601 (Counterclockwise)

Preceding gene: 182681551

Following gene: 182681548

Centisome position: 45.92

GC content: 54.69

Gene sequence:

>2730_bases
TTGCCCCCACTGCAACCATCATTAGCTGCGAAGATCGGGCGGCATCTTGAATTGACTAATACAGAAGCCGCGCATGCGCT
TGGTTTGACGGGCAGTGGCTTTATTATTGGTATGGTTGACACCGGCGTGAATCGTAACAATATTGCGTTACAGGGGAAGG
TGATTCGCAACGGTGTCTATAATTTCTATACGGATTATCACGCCCCCTCGGCTCCGGACGATGTTGACGATCATGGCACC
TTAGTGGCGCAGCTAATTGCTGGTAAACCGGTTGAACACTGGCCTGGTGGCATCGCACCAGGTGCCTCCATCTTCTCAGC
GCGTGTTTACCCGTCTGAAGAAGAATTTGAAGCATACATCGAAGAACAAATGGCATCCTCACACATCGTGGATACTTATG
AAGCAGAAGCATCGAAGATAAAGCTTATTAATGCTGACATGATTGCTGCGGGAGTGCGCATCCAAAACAACTCATGGGGC
CATTCGAGGGCTGGAATGTGGACAGATCCAAAGATCACGAATTTGTTCGCGGACACATACCGTGACTTTGTGATCGGCAA
CAATGGTTTGGTGGTATTCAGCACTGGTAACGAAAAGCTATCACAACCAAACGGACTTGCCAGACTGCCGAGCTTGCTTA
CGGCGGAGGGCTCCCCATTGGCCGCCGATCTGGAAAAGGGATGGTTAGCCGTCGCTGGACTGGACAGTTTTGATCACCCC
GACCAGTTGGGTTCCTACTCCAATCACTGTGGTGTTGCAATGCACTATTGCTTGGCAGCCCCAGGTAATGTCCTAGTCAT
TGATTCCAACGTGACTACCACCCCTATTGGCAATGATGAATACAAAGAACAACGCGGCACGTCCTTTTCAGCGCCTTTGG
TATCTGGTGCAGCGGCCTTGGTGTGGGAGGCATATCCATACTTCACCAATGACCTAGTGCGTCAGACATTGCTTGGGACG
GCCACCGATCTTGGTGCTCCTGGTGTGGACGAAGTATTCGGGTATGGCGCCCTGAATGTGGGCAAAGCGGTGCGTGGGCC
CGCCAAGTTTGATTGGGGCGATGTTAAAGTCAGCTTCAATGACAGCCGTTCGACCTGGTTCAATGATATTAGCGGCGGCG
GTGGTTTGATCAAAGACGGTACAGGAACCTTGGTGCTTGCTGGCAGCGCCAACCAATATAGTGGAGCGATCCAAGTGCTT
GGAGGCACACTCCAGGTAAGCAGCCTAGGTGAGTCGGCGGTGAGCATTGCCCACAGTGCGACCTTGATTGGCAGTGGTCG
CTTTGGTGGTGCAGTGAGCAATGCAGGCACCTTAGAGATTGGTACAGATGGCCTAAAGGTTCAAGGCGATTACACCCAGT
CTGAGACAGGGCGTCTTGCGTTGAACGTGGGTGATCAACTGAGCGTTGCAGGCCATGCCACCCTCCAAGGGGGTGAACTT
CAGGTGCTGGGCAAGCGCGATTATGTGAGCTTGAATACCTCCTACAGCGTGTTACATGCGGATGGTGGTTTGACCGGGAC
GTTCTCGGGGTTGACCTGGGGTCCGGCGGTGCTGCTGGGAGAAGGTCAGCTTCACTACGGTGCCAACGATGCTAACGTGA
CCCTGCAGCGCCTGGACGTCAATGCGGCGGCTCGTGCATTGGGGATTGTTGATACTGTTGCGCAGGCTTCTGCCCGACGA
GTTGAGCAAGCGTTCCGTGAAATTGACATTCAGCAGGCCCAAGGCCGCGGTCAGTTATCGACTTCCTTTATGGCGGCGGC
GGCGGCCCTGCAACAGTCTGGGAGCGCACAAATGGCATCGGCTTCGCTGCATAGTTTGTCCGGTCAAGGGCATGTTGCGG
CAACGGCGTCCAGCTTTGATGTTGTTGATGCGGGACGACGCAGCCTTGCCACCCGTCTGGGTGAGCGCCCATTGGGCGAA
CGTACGGTGACGTGGCGTCAGTCATTGGGTGGTTCTGGTCATGATGGGACTGCTGGAGGCACATTTGCACTGTCTGGCTG
GTTGCTTGGGCGCGATACACAACTGGCCTCTGGCGACATTGTGGGTTTTGCTTTTGGTCAGTCTGAGGCCAGTCCATCCG
GCAGCGTGTCAGGGCTACGTGGTCTTGACAGACAAGTGCAAGGGCGTATGTATGTACAGCGTAGCCAAGGCCCCTTGTAT
GTATTGGGTCAGCTTGGTTTTGGCAGTTTTCAACGCCGTCTGGACCGGCAGTTGCAATTGGGTCATTGGAGTGACTGGGC
AAGCAGTCGCTACCGTGGTCAATTTTTCAGTGGGAGTGTAGAGGCTGGGTATCATTGGCGCCGTGGTGCATGGGCCTTGA
CGCCGTATGTGGGTGTAGATCAAACGCAGCTGAAGACGGATGGATTCCGTGAGCAGGGAGGGGCGGGCTTTGGCTTACAG
GTACAGGCGTCCCAAGCTATTCGGAGCCAGTTACTGGCTGGTGTTCGTACTGAATTAGGGTGGCGTGGAGTGAAGCTACG
TGGCTATGGTGAGTGGCAGCAGACCTTGCGTCAGAGTGGGTTGAATCCACAGGCTAGCTTTACGGCGACATCGTCATGGA
CGCCCTTGGTGGCATCCCCCTGGTCTAGTCGTTCTGGCGGACTTCTTGGCTTATCAATGGTCTGGCCCGTGGGGATGACG
GCAGGAGAGTGGAGCATGGGTGTAGAACACTTCTTTGGTGCCCGTAAACGCAGTGATAGCTTGGGTTTGCGTTATCAGCT
GAGTTTCTAG

Upstream 100 bases:

>100_bases
TACACCCACACCTACACCCACACCTACACCCACACCTACACCCACACCCACACCCACACCTACACCCACACCTACACCCA
CACCTACACCTACACCCACA

Downstream 100 bases:

>100_bases
TCTGAGTATGGAAGCCGATGCACGGTAGTGCCGTGCATCGGCGGTGTTTAGTAATGCGTGTGCTAGACAGAGCTGTACAT
TGCGTGCCTCGCGTGCGAGT

Product: beta strand repeat-containing protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 909; Mature: 908

Protein sequence:

>909_residues
MPPLQPSLAAKIGRHLELTNTEAAHALGLTGSGFIIGMVDTGVNRNNIALQGKVIRNGVYNFYTDYHAPSAPDDVDDHGT
LVAQLIAGKPVEHWPGGIAPGASIFSARVYPSEEEFEAYIEEQMASSHIVDTYEAEASKIKLINADMIAAGVRIQNNSWG
HSRAGMWTDPKITNLFADTYRDFVIGNNGLVVFSTGNEKLSQPNGLARLPSLLTAEGSPLAADLEKGWLAVAGLDSFDHP
DQLGSYSNHCGVAMHYCLAAPGNVLVIDSNVTTTPIGNDEYKEQRGTSFSAPLVSGAAALVWEAYPYFTNDLVRQTLLGT
ATDLGAPGVDEVFGYGALNVGKAVRGPAKFDWGDVKVSFNDSRSTWFNDISGGGGLIKDGTGTLVLAGSANQYSGAIQVL
GGTLQVSSLGESAVSIAHSATLIGSGRFGGAVSNAGTLEIGTDGLKVQGDYTQSETGRLALNVGDQLSVAGHATLQGGEL
QVLGKRDYVSLNTSYSVLHADGGLTGTFSGLTWGPAVLLGEGQLHYGANDANVTLQRLDVNAAARALGIVDTVAQASARR
VEQAFREIDIQQAQGRGQLSTSFMAAAAALQQSGSAQMASASLHSLSGQGHVAATASSFDVVDAGRRSLATRLGERPLGE
RTVTWRQSLGGSGHDGTAGGTFALSGWLLGRDTQLASGDIVGFAFGQSEASPSGSVSGLRGLDRQVQGRMYVQRSQGPLY
VLGQLGFGSFQRRLDRQLQLGHWSDWASSRYRGQFFSGSVEAGYHWRRGAWALTPYVGVDQTQLKTDGFREQGGAGFGLQ
VQASQAIRSQLLAGVRTELGWRGVKLRGYGEWQQTLRQSGLNPQASFTATSSWTPLVASPWSSRSGGLLGLSMVWPVGMT
AGEWSMGVEHFFGARKRSDSLGLRYQLSF

Sequences:

>Translated_909_residues
MPPLQPSLAAKIGRHLELTNTEAAHALGLTGSGFIIGMVDTGVNRNNIALQGKVIRNGVYNFYTDYHAPSAPDDVDDHGT
LVAQLIAGKPVEHWPGGIAPGASIFSARVYPSEEEFEAYIEEQMASSHIVDTYEAEASKIKLINADMIAAGVRIQNNSWG
HSRAGMWTDPKITNLFADTYRDFVIGNNGLVVFSTGNEKLSQPNGLARLPSLLTAEGSPLAADLEKGWLAVAGLDSFDHP
DQLGSYSNHCGVAMHYCLAAPGNVLVIDSNVTTTPIGNDEYKEQRGTSFSAPLVSGAAALVWEAYPYFTNDLVRQTLLGT
ATDLGAPGVDEVFGYGALNVGKAVRGPAKFDWGDVKVSFNDSRSTWFNDISGGGGLIKDGTGTLVLAGSANQYSGAIQVL
GGTLQVSSLGESAVSIAHSATLIGSGRFGGAVSNAGTLEIGTDGLKVQGDYTQSETGRLALNVGDQLSVAGHATLQGGEL
QVLGKRDYVSLNTSYSVLHADGGLTGTFSGLTWGPAVLLGEGQLHYGANDANVTLQRLDVNAAARALGIVDTVAQASARR
VEQAFREIDIQQAQGRGQLSTSFMAAAAALQQSGSAQMASASLHSLSGQGHVAATASSFDVVDAGRRSLATRLGERPLGE
RTVTWRQSLGGSGHDGTAGGTFALSGWLLGRDTQLASGDIVGFAFGQSEASPSGSVSGLRGLDRQVQGRMYVQRSQGPLY
VLGQLGFGSFQRRLDRQLQLGHWSDWASSRYRGQFFSGSVEAGYHWRRGAWALTPYVGVDQTQLKTDGFREQGGAGFGLQ
VQASQAIRSQLLAGVRTELGWRGVKLRGYGEWQQTLRQSGLNPQASFTATSSWTPLVASPWSSRSGGLLGLSMVWPVGMT
AGEWSMGVEHFFGARKRSDSLGLRYQLSF
>Mature_908_residues
PPLQPSLAAKIGRHLELTNTEAAHALGLTGSGFIIGMVDTGVNRNNIALQGKVIRNGVYNFYTDYHAPSAPDDVDDHGTL
VAQLIAGKPVEHWPGGIAPGASIFSARVYPSEEEFEAYIEEQMASSHIVDTYEAEASKIKLINADMIAAGVRIQNNSWGH
SRAGMWTDPKITNLFADTYRDFVIGNNGLVVFSTGNEKLSQPNGLARLPSLLTAEGSPLAADLEKGWLAVAGLDSFDHPD
QLGSYSNHCGVAMHYCLAAPGNVLVIDSNVTTTPIGNDEYKEQRGTSFSAPLVSGAAALVWEAYPYFTNDLVRQTLLGTA
TDLGAPGVDEVFGYGALNVGKAVRGPAKFDWGDVKVSFNDSRSTWFNDISGGGGLIKDGTGTLVLAGSANQYSGAIQVLG
GTLQVSSLGESAVSIAHSATLIGSGRFGGAVSNAGTLEIGTDGLKVQGDYTQSETGRLALNVGDQLSVAGHATLQGGELQ
VLGKRDYVSLNTSYSVLHADGGLTGTFSGLTWGPAVLLGEGQLHYGANDANVTLQRLDVNAAARALGIVDTVAQASARRV
EQAFREIDIQQAQGRGQLSTSFMAAAAALQQSGSAQMASASLHSLSGQGHVAATASSFDVVDAGRRSLATRLGERPLGER
TVTWRQSLGGSGHDGTAGGTFALSGWLLGRDTQLASGDIVGFAFGQSEASPSGSVSGLRGLDRQVQGRMYVQRSQGPLYV
LGQLGFGSFQRRLDRQLQLGHWSDWASSRYRGQFFSGSVEAGYHWRRGAWALTPYVGVDQTQLKTDGFREQGGAGFGLQV
QASQAIRSQLLAGVRTELGWRGVKLRGYGEWQQTLRQSGLNPQASFTATSSWTPLVASPWSSRSGGLLGLSMVWPVGMTA
GEWSMGVEHFFGARKRSDSLGLRYQLSF

Specific function: Unknown

COG id: COG1404

COG function: function code O; Subtilisin-like serine proteases

Gene ontology:

Cell location: Secreted [H]

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Contains 1 peptidase S8 domain [H]

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR005546
- InterPro:   IPR013425
- InterPro:   IPR006315
- InterPro:   IPR011050
- InterPro:   IPR000209
- InterPro:   IPR022398
- InterPro:   IPR015500 [H]

Pfam domain/function: PF03797 Autotransporter; PF00082 Peptidase_S8 [H]

EC number: NA

Molecular weight: Translated: 96067; Mature: 95936

Theoretical pI: Translated: 6.35; Mature: 6.35

Prosite motif: PS00136 SUBTILASE_ASP ; PS00138 SUBTILASE_SER ; PS00141 ASP_PROTEASE

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.2 %Cys     (Translated Protein)
1.3 %Met     (Translated Protein)
1.5 %Cys+Met (Translated Protein)
0.2 %Cys     (Mature Protein)
1.2 %Met     (Mature Protein)
1.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MPPLQPSLAAKIGRHLELTNTEAAHALGLTGSGFIIGMVDTGVNRNNIALQGKVIRNGVY
CCCCCHHHHHHHCCCEEECCCCHHHEECCCCCCEEEEEEECCCCCCCEEEEEEHHHCCCH
NFYTDYHAPSAPDDVDDHGTLVAQLIAGKPVEHWPGGIAPGASIFSARVYPSEEEFEAYI
HEEECCCCCCCCCCCCCCHHHHHHHHCCCCHHHCCCCCCCCCHHEEEECCCCHHHHHHHH
EEQMASSHIVDTYEAEASKIKLINADMIAAGVRIQNNSWGHSRAGMWTDPKITNLFADTY
HHHHHHHCCCCCCCCCCCEEEEEECCEEEECEEEECCCCCCCCCCCCCCCHHHHHHHHHH
RDFVIGNNGLVVFSTGNEKLSQPNGLARLPSLLTAEGSPLAADLEKGWLAVAGLDSFDHP
HHEEECCCCEEEEECCCHHCCCCCCHHHCCHHHCCCCCCCEEHHCCCEEEEECCCCCCCC
DQLGSYSNHCGVAMHYCLAAPGNVLVIDSNVTTTPIGNDEYKEQRGTSFSAPLVSGAAAL
HHHCCCCCCCHHHHHHHHCCCCCEEEECCCCEECCCCCCHHHHHCCCCCCCHHHHCCCEE
VWEAYPYFTNDLVRQTLLGTATDLGAPGVDEVFGYGALNVGKAVRGPAKFDWGDVKVSFN
EHCCCCHHHHHHHHHHHHHCHHCCCCCCHHHHHCCCCCCCCHHHCCCCCCCCCEEEEEEC
DSRSTWFNDISGGGGLIKDGTGTLVLAGSANQYSGAIQVLGGTLQVSSLGESAVSIAHSA
CCCCCCCCCCCCCCCEEECCCCEEEEECCCCCCCCEEEEECCEEEECCCCHHHHHHHHHE
TLIGSGRFGGAVSNAGTLEIGTDGLKVQGDYTQSETGRLALNVGDQLSVAGHATLQGGEL
EEEECCCCCCCCCCCCEEEECCCCEEEECCCCCCCCCEEEEECCCCEEECEEEEECCCEE
QVLGKRDYVSLNTSYSVLHADGGLTGTFSGLTWGPAVLLGEGQLHYGANDANVTLQRLDV
EEEECCCEEEECCCEEEEEECCCCEEECCCCCCCCEEEEECCEEEECCCCCCEEEEEECC
NAAARALGIVDTVAQASARRVEQAFREIDIQQAQGRGQLSTSFMAAAAALQQSGSAQMAS
HHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHCCCCCHHHHHHHHHHHHHHCCCCHHHH
ASLHSLSGQGHVAATASSFDVVDAGRRSLATRLGERPLGERTVTWRQSLGGSGHDGTAGG
HHHHHCCCCCCEEEECCCCCHHHHHHHHHHHHHCCCCCCCCEEHHHHHCCCCCCCCCCCC
TFALSGWLLGRDTQLASGDIVGFAFGQSEASPSGSVSGLRGLDRQVQGRMYVQRSQGPLY
EEEEEEEEECCCCCCCCCCEEEEEECCCCCCCCCCCHHHHHHHHHHCCCEEEEECCCCEE
VLGQLGFGSFQRRLDRQLQLGHWSDWASSRYRGQFFSGSVEAGYHWRRGAWALTPYVGVD
EEEECCCCHHHHHHHHHHCCCCCCHHHCCCCCCCEECCCCCCCCEEECCCEEECCCCCCC
QTQLKTDGFREQGGAGFGLQVQASQAIRSQLLAGVRTELGWRGVKLRGYGEWQQTLRQSG
CHHCCCCCCHHCCCCCCEEEEEHHHHHHHHHHHHHHHHCCCCEEEEEECCHHHHHHHHCC
LNPQASFTATSSWTPLVASPWSSRSGGLLGLSMVWPVGMTAGEWSMGVEHFFGARKRSDS
CCCCCCEEECCCCCCEEECCCCCCCCCEEEEEECCCCCCCCCCHHHCHHHHHCCCCCCCC
LGLRYQLSF
CCEEEEECC
>Mature Secondary Structure 
PPLQPSLAAKIGRHLELTNTEAAHALGLTGSGFIIGMVDTGVNRNNIALQGKVIRNGVY
CCCCHHHHHHHCCCEEECCCCHHHEECCCCCCEEEEEEECCCCCCCEEEEEEHHHCCCH
NFYTDYHAPSAPDDVDDHGTLVAQLIAGKPVEHWPGGIAPGASIFSARVYPSEEEFEAYI
HEEECCCCCCCCCCCCCCHHHHHHHHCCCCHHHCCCCCCCCCHHEEEECCCCHHHHHHHH
EEQMASSHIVDTYEAEASKIKLINADMIAAGVRIQNNSWGHSRAGMWTDPKITNLFADTY
HHHHHHHCCCCCCCCCCCEEEEEECCEEEECEEEECCCCCCCCCCCCCCCHHHHHHHHHH
RDFVIGNNGLVVFSTGNEKLSQPNGLARLPSLLTAEGSPLAADLEKGWLAVAGLDSFDHP
HHEEECCCCEEEEECCCHHCCCCCCHHHCCHHHCCCCCCCEEHHCCCEEEEECCCCCCCC
DQLGSYSNHCGVAMHYCLAAPGNVLVIDSNVTTTPIGNDEYKEQRGTSFSAPLVSGAAAL
HHHCCCCCCCHHHHHHHHCCCCCEEEECCCCEECCCCCCHHHHHCCCCCCCHHHHCCCEE
VWEAYPYFTNDLVRQTLLGTATDLGAPGVDEVFGYGALNVGKAVRGPAKFDWGDVKVSFN
EHCCCCHHHHHHHHHHHHHCHHCCCCCCHHHHHCCCCCCCCHHHCCCCCCCCCEEEEEEC
DSRSTWFNDISGGGGLIKDGTGTLVLAGSANQYSGAIQVLGGTLQVSSLGESAVSIAHSA
CCCCCCCCCCCCCCCEEECCCCEEEEECCCCCCCCEEEEECCEEEECCCCHHHHHHHHHE
TLIGSGRFGGAVSNAGTLEIGTDGLKVQGDYTQSETGRLALNVGDQLSVAGHATLQGGEL
EEEECCCCCCCCCCCCEEEECCCCEEEECCCCCCCCCEEEEECCCCEEECEEEEECCCEE
QVLGKRDYVSLNTSYSVLHADGGLTGTFSGLTWGPAVLLGEGQLHYGANDANVTLQRLDV
EEEECCCEEEECCCEEEEEECCCCEEECCCCCCCCEEEEECCEEEECCCCCCEEEEEECC
NAAARALGIVDTVAQASARRVEQAFREIDIQQAQGRGQLSTSFMAAAAALQQSGSAQMAS
HHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHCCCCCHHHHHHHHHHHHHHCCCCHHHH
ASLHSLSGQGHVAATASSFDVVDAGRRSLATRLGERPLGERTVTWRQSLGGSGHDGTAGG
HHHHHCCCCCCEEEECCCCCHHHHHHHHHHHHHCCCCCCCCEEHHHHHCCCCCCCCCCCC
TFALSGWLLGRDTQLASGDIVGFAFGQSEASPSGSVSGLRGLDRQVQGRMYVQRSQGPLY
EEEEEEEEECCCCCCCCCCEEEEEECCCCCCCCCCCHHHHHHHHHHCCCEEEEECCCCEE
VLGQLGFGSFQRRLDRQLQLGHWSDWASSRYRGQFFSGSVEAGYHWRRGAWALTPYVGVD
EEEECCCCHHHHHHHHHHCCCCCCHHHCCCCCCCEECCCCCCCCEEECCCEEECCCCCCC
QTQLKTDGFREQGGAGFGLQVQASQAIRSQLLAGVRTELGWRGVKLRGYGEWQQTLRQSG
CHHCCCCCCHHCCCCCCEEEEEHHHHHHHHHHHHHHHHCCCCEEEEEECCHHHHHHHHCC
LNPQASFTATSSWTPLVASPWSSRSGGLLGLSMVWPVGMTAGEWSMGVEHFFGARKRSDS
CCCCCCEEECCCCCCEEECCCCCCCCCEEEEEECCCCCCCCCCHHHCHHHHHCCCCCCCC
LGLRYQLSF
CCEEEEECC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 3011754; 1639760 [H]