Definition Ralstonia solanacearum GMI1000, complete genome.
Accession NC_003295
Length 3,716,413

Click here to switch to the map view.

The map label for this gene is comE [H]

Identifier: 17547022

GI number: 17547022

Start: 2502818

End: 2505187

Strand: Reverse

Name: comE [H]

Synonym: RSc2303

Alternate gene names: 17547022

Gene position: 2505187-2502818 (Counterclockwise)

Preceding gene: 17547023

Following gene: 17547021

Centisome position: 67.41

GC content: 69.11

Gene sequence:

>2370_bases
ATGAAACCGTCCTGCCGTCCGGGTGCGGCGCTTGAAGCGGACCGCTGCCCATCGTTCCCCGATCGAAGCGCCGCCACGCC
GCACCGCGGTCTGGCGTGGGCCATGGCTGTGGTCCTGATCGGCGGGTGCGCCACTACCAGGGACATCGAGCAGCTGCAGA
CCACCAGCCAGCGGGAGCCGACCAACGCGCAGCTCAAGCTCAAGTACATGGATGAGCGCGACCGCCAGGTCAAGGACTTG
CTCGACGGGGCGGACCGGCTGCGCCTCATCCACGATTTCGACCGGGCCCAGGTCCTGCTCCTGCAAGCCCTGCGGCTGGA
TCCGGGCAACGAGCGCGGCAGGCGCATCGCCGCCGCCATCGATGTGGACCGGCGCAACGGCGCCGTGCTCCAGGAAGCGG
AGCGGATGATGGCGCGCGGCTCGTATGACGGCGCGGCCGAGCGCGTCGAGCGCGTGCTCGCGGAGACTCCGAACGATGCC
GGCGCATTGCGCCTCTACCGCGAGATCAGCGAGAAGCGGCGCCTGCAAAAGCAGGCCGCCGAAGAGAAGAACGCCGCGGC
GTCGATCATGCGCAAGCCGGTGTCGCTGCAGTTCCGGGATGCCAACGTGCGCATGGTGTTCGAAGCGCTGTCGCGCACGA
CGGGCCTGAGCGTCATCTTCGATCGCGATGTGCGCGTCGATCTGAAGACCACGATCTTCGTCTCGAATGCCTCGCTCGAA
GACACGGTCGACATGATCCTGCTGCAGAACCAGCTCGCGAAGAAGGTGCTCAACGCCAACACGGTGTTCATCTATCCGGC
CACGCCGGCCAAGCAGCAGGAATACCAGGACCTCAAGGTGCGCACGTTCCAGCTGTCCAACACGGATGCCAAGCACATCG
ACACGCTGCTGAAGAATCTCCTGAAGATCAAGGAGATCGTCACCGACGAGCGCGCCAATACCGTGTCGATCCGGGCGACG
CCCGAGACCATCCGCGTGGCCGAGCGGATGATCGCCGCGCAGGATCTGCCCGAGCCGGAGGTGATGCTGGAAGTCGAGGT
GCTGGAGGTGTCGCGCGACCGGCTCACCGATCTGGGCATCGACTGGCCGAACAGCTTCTCGCTCGGGACGCCGTCCTCGG
CAAGCACGTGGGGCGCGCTGCATCACCTGACGGTCAATCAGCTCACGGCCAGCGGGCTGTCGGTGACGGCCAATCTCAAG
CTGACCGATACCGACGCGAACCTGCTGGCGAGCCCGCGCATCCGCACGCGCAACAAGGAGAAGGCCAAGATCCTGATCGG
CGACAAGGTGCCCGTGATCTCGAGCTCCAGCGTGCCGAGCACCAGCGGCCCGGTCTATTCGCAGTCGATCCAGTACCTGG
ATGTCGGCATCAAGCTGGAGGTCGAGCCCCAGGTGTACCGGGACAACGATGTCGGCATCAAGATGAGCCTCGAGGTCAGC
AACATCACCCAGATCATTTCGAGCAGCAACGCGCAGACCGGCCTGAGCTCGCTCGCTTACCAGATCGGCACCCGCAATGC
GTCGACGACGCTGCGGCTCAAGGACGGCGAGACCCAGATTCTCGGCGGCCTGATCCAGGATGAGGATCGGGACGCGGCCA
ACAAGGTCCCGGGGCTTGGGCAGTTGCCGGTGCTCGGGCGCCTGTTCTCGAACCACAACGGCGACCACAAGAAGACCGAG
ATCGTGCTGCAGATCACGCCGCATATCGTGCGGCCGCAGCTGGCGGCGGATGCGGATACGCGCGAGATCTGGTCCGGCAC
CGACAGCACTGTGCGCACCGAGCAATTGCGGCTCGATCCGCCGGGCGTGGCCGCGCCTGCCACACCTGCTGCGCCTGCTG
CGCCTGCTGCGGCGCTTCCGGCGCCGGCCGCCGGGGTGGCGGTCGTCTCCCCGGGCGCCGTCGGCGGCGGTACCACGGGT
GGCGAACAGACGCCCAAGGCTGCCGCGCCGGCCGCGGCCGGCGGCGTGGTTCCGCCCAACGGCGCGTTTGGGCAGCCGCC
CGCCGCGCCGCGCACGACGCCGCCGCCGGCAATGTTCGGTGGCCGCTTCATGACCACGGTGCCGCCGCCCGAAGGGGTTG
TGCCACCGGCGCCGCCGGCACCGGCAGCCGCGCCTGCGGCGGTGGCAGCGCCGGCAGCGGCGGCACCAGCAGCACCGGCG
GCTGGCACGGCCGGGCCCGAGGCAGCGGCAGCGGTCAGCCCGACCGAGGCCGCACCGCCCGCACCCGCGCCGGCAGCGCC
ATACACGCCAGCGCCCGCCGCGCCCGCCGCCGCGCCGCCAGCGGCATCGCCGCCGCCGATCGTGCCGACGCCGCCGAGCG
ACATGCCGAGCGATAACCCGTTGCATCCGATCCCGACGGGGGCGTACTGA

Upstream 100 bases:

>100_bases
GGTGTACCGATTCGAATCGATCGCGGCCACGGAAGCGCGCTTTACCTACCTGCCGCTCAACCAGCGGCAAGTGATGTCCG
TTCAAGGCGAGGGGAACTAA

Downstream 100 bases:

>100_bases
GCCATGGTCCGCCTGAGGGACCTCCACCTTGGCCGTGGCCGCGCGAACTGCCGCGGCCACGGCTTCACGCTGATCGAGCT
CGTCATCACGCTTGCGCTGG

Product: GSPD-like protein

Products: NA

Alternate protein names: DNA transformation protein ComE [H]

Number of amino acids: Translated: 789; Mature: 789

Protein sequence:

>789_residues
MKPSCRPGAALEADRCPSFPDRSAATPHRGLAWAMAVVLIGGCATTRDIEQLQTTSQREPTNAQLKLKYMDERDRQVKDL
LDGADRLRLIHDFDRAQVLLLQALRLDPGNERGRRIAAAIDVDRRNGAVLQEAERMMARGSYDGAAERVERVLAETPNDA
GALRLYREISEKRRLQKQAAEEKNAAASIMRKPVSLQFRDANVRMVFEALSRTTGLSVIFDRDVRVDLKTTIFVSNASLE
DTVDMILLQNQLAKKVLNANTVFIYPATPAKQQEYQDLKVRTFQLSNTDAKHIDTLLKNLLKIKEIVTDERANTVSIRAT
PETIRVAERMIAAQDLPEPEVMLEVEVLEVSRDRLTDLGIDWPNSFSLGTPSSASTWGALHHLTVNQLTASGLSVTANLK
LTDTDANLLASPRIRTRNKEKAKILIGDKVPVISSSSVPSTSGPVYSQSIQYLDVGIKLEVEPQVYRDNDVGIKMSLEVS
NITQIISSSNAQTGLSSLAYQIGTRNASTTLRLKDGETQILGGLIQDEDRDAANKVPGLGQLPVLGRLFSNHNGDHKKTE
IVLQITPHIVRPQLAADADTREIWSGTDSTVRTEQLRLDPPGVAAPATPAAPAAPAAALPAPAAGVAVVSPGAVGGGTTG
GEQTPKAAAPAAAGGVVPPNGAFGQPPAAPRTTPPPAMFGGRFMTTVPPPEGVVPPAPPAPAAAPAAVAAPAAAAPAAPA
AGTAGPEAAAAVSPTEAAPPAPAPAAPYTPAPAAPAAAPPAASPPPIVPTPPSDMPSDNPLHPIPTGAY

Sequences:

>Translated_789_residues
MKPSCRPGAALEADRCPSFPDRSAATPHRGLAWAMAVVLIGGCATTRDIEQLQTTSQREPTNAQLKLKYMDERDRQVKDL
LDGADRLRLIHDFDRAQVLLLQALRLDPGNERGRRIAAAIDVDRRNGAVLQEAERMMARGSYDGAAERVERVLAETPNDA
GALRLYREISEKRRLQKQAAEEKNAAASIMRKPVSLQFRDANVRMVFEALSRTTGLSVIFDRDVRVDLKTTIFVSNASLE
DTVDMILLQNQLAKKVLNANTVFIYPATPAKQQEYQDLKVRTFQLSNTDAKHIDTLLKNLLKIKEIVTDERANTVSIRAT
PETIRVAERMIAAQDLPEPEVMLEVEVLEVSRDRLTDLGIDWPNSFSLGTPSSASTWGALHHLTVNQLTASGLSVTANLK
LTDTDANLLASPRIRTRNKEKAKILIGDKVPVISSSSVPSTSGPVYSQSIQYLDVGIKLEVEPQVYRDNDVGIKMSLEVS
NITQIISSSNAQTGLSSLAYQIGTRNASTTLRLKDGETQILGGLIQDEDRDAANKVPGLGQLPVLGRLFSNHNGDHKKTE
IVLQITPHIVRPQLAADADTREIWSGTDSTVRTEQLRLDPPGVAAPATPAAPAAPAAALPAPAAGVAVVSPGAVGGGTTG
GEQTPKAAAPAAAGGVVPPNGAFGQPPAAPRTTPPPAMFGGRFMTTVPPPEGVVPPAPPAPAAAPAAVAAPAAAAPAAPA
AGTAGPEAAAAVSPTEAAPPAPAPAAPYTPAPAAPAAAPPAASPPPIVPTPPSDMPSDNPLHPIPTGAY
>Mature_789_residues
MKPSCRPGAALEADRCPSFPDRSAATPHRGLAWAMAVVLIGGCATTRDIEQLQTTSQREPTNAQLKLKYMDERDRQVKDL
LDGADRLRLIHDFDRAQVLLLQALRLDPGNERGRRIAAAIDVDRRNGAVLQEAERMMARGSYDGAAERVERVLAETPNDA
GALRLYREISEKRRLQKQAAEEKNAAASIMRKPVSLQFRDANVRMVFEALSRTTGLSVIFDRDVRVDLKTTIFVSNASLE
DTVDMILLQNQLAKKVLNANTVFIYPATPAKQQEYQDLKVRTFQLSNTDAKHIDTLLKNLLKIKEIVTDERANTVSIRAT
PETIRVAERMIAAQDLPEPEVMLEVEVLEVSRDRLTDLGIDWPNSFSLGTPSSASTWGALHHLTVNQLTASGLSVTANLK
LTDTDANLLASPRIRTRNKEKAKILIGDKVPVISSSSVPSTSGPVYSQSIQYLDVGIKLEVEPQVYRDNDVGIKMSLEVS
NITQIISSSNAQTGLSSLAYQIGTRNASTTLRLKDGETQILGGLIQDEDRDAANKVPGLGQLPVLGRLFSNHNGDHKKTE
IVLQITPHIVRPQLAADADTREIWSGTDSTVRTEQLRLDPPGVAAPATPAAPAAPAAALPAPAAGVAVVSPGAVGGGTTG
GEQTPKAAAPAAAGGVVPPNGAFGQPPAAPRTTPPPAMFGGRFMTTVPPPEGVVPPAPPAPAAAPAAVAAPAAAAPAAPA
AGTAGPEAAAAVSPTEAAPPAPAPAAPYTPAPAAPAAAPPAASPPPIVPTPPSDMPSDNPLHPIPTGAY

Specific function: Involved in transformation (competence for DNA uptake) [H]

COG id: COG4796

COG function: function code U; Type II secretory pathway, component HofQ

Gene ontology:

Cell location: Cell outer membrane (Probable) [H]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the GSP D family [H]

Homologues:

Organism=Escherichia coli, GI1789793, Length=402, Percent_Identity=23.134328358209, Blast_Score=88, Evalue=2e-18,
Organism=Escherichia coli, GI87082242, Length=295, Percent_Identity=27.1186440677966, Blast_Score=83, Evalue=6e-17,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR001775
- InterPro:   IPR005644
- InterPro:   IPR013355
- InterPro:   IPR004846
- InterPro:   IPR004845
- InterPro:   IPR001814 [H]

Pfam domain/function: PF00263 Secretin; PF03958 Secretin_N [H]

EC number: NA

Molecular weight: Translated: 83303; Mature: 83303

Theoretical pI: Translated: 6.63; Mature: 6.63

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.4 %Cys     (Translated Protein)
1.8 %Met     (Translated Protein)
2.2 %Cys+Met (Translated Protein)
0.4 %Cys     (Mature Protein)
1.8 %Met     (Mature Protein)
2.2 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKPSCRPGAALEADRCPSFPDRSAATPHRGLAWAMAVVLIGGCATTRDIEQLQTTSQREP
CCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHCCCCCHHHHHHHHHHCCCCC
TNAQLKLKYMDERDRQVKDLLDGADRLRLIHDFDRAQVLLLQALRLDPGNERGRRIAAAI
CCCEEEEEECCCHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCEEEEEE
DVDRRNGAVLQEAERMMARGSYDGAAERVERVLAETPNDAGALRLYREISEKRRLQKQAA
EECCCCCHHHHHHHHHHHCCCCCHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHH
EEKNAAASIMRKPVSLQFRDANVRMVFEALSRTTGLSVIFDRDVRVDLKTTIFVSNASLE
HHHHHHHHHHCCCCEEEEECCCHHHHHHHHHHCCCEEEEEECCEEEEEEEEEEEECCCHH
DTVDMILLQNQLAKKVLNANTVFIYPATPAKQQEYQDLKVRTFQLSNTDAKHIDTLLKNL
HHHHHHHHHHHHHHHHHCCCEEEEEECCCCCHHHHCCCEEEEEEECCCCHHHHHHHHHHH
LKIKEIVTDERANTVSIRATPETIRVAERMIAAQDLPEPEVMLEVEVLEVSRDRLTDLGI
HHHHHHHHCCCCCEEEEEECHHHHHHHHHHHHHHCCCCCCEEEEEEEEHHHHHHHHHCCC
DWPNSFSLGTPSSASTWGALHHLTVNQLTASGLSVTANLKLTDTDANLLASPRIRTRNKE
CCCCCCCCCCCCCCCHHHHHHEEEHHHHHCCCCEEEEEEEEECCCCCCEECCCCCCCCCC
KAKILIGDKVPVISSSSVPSTSGPVYSQSIQYLDVGIKLEVEPQVYRDNDVGIKMSLEVS
CEEEEECCCCCEEECCCCCCCCCCCHHCCEEEEEEEEEEEECCCEEECCCCCEEEEEEHH
NITQIISSSNAQTGLSSLAYQIGTRNASTTLRLKDGETQILGGLIQDEDRDAANKVPGLG
HHHHHHHCCCHHHHHHHHHHHHCCCCCCEEEEEECCCHHHHHHHHCCCCCCHHHCCCCCC
QLPVLGRLFSNHNGDHKKTEIVLQITPHIVRPQLAADADTREIWSGTDSTVRTEQLRLDP
CCHHHHHHHHCCCCCCCEEEEEEEECCCHHCCCHHCCCCHHHHHCCCCCCEEEEEEEECC
PGVAAPATPAAPAAPAAALPAPAAGVAVVSPGAVGGGTTGGEQTPKAAAPAAAGGVVPPN
CCCCCCCCCCCCCCCCCCCCCCCCCEEEECCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC
GAFGQPPAAPRTTPPPAMFGGRFMTTVPPPEGVVPPAPPAPAAAPAAVAAPAAAAPAAPA
CCCCCCCCCCCCCCCCHHHCCEEEEECCCCCCCCCCCCCCCCCCCHHHHCCCCCCCCCCC
AGTAGPEAAAAVSPTEAAPPAPAPAAPYTPAPAAPAAAPPAASPPPIVPTPPSDMPSDNP
CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC
LHPIPTGAY
CCCCCCCCC
>Mature Secondary Structure
MKPSCRPGAALEADRCPSFPDRSAATPHRGLAWAMAVVLIGGCATTRDIEQLQTTSQREP
CCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHCCCCCHHHHHHHHHHCCCCC
TNAQLKLKYMDERDRQVKDLLDGADRLRLIHDFDRAQVLLLQALRLDPGNERGRRIAAAI
CCCEEEEEECCCHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCEEEEEE
DVDRRNGAVLQEAERMMARGSYDGAAERVERVLAETPNDAGALRLYREISEKRRLQKQAA
EECCCCCHHHHHHHHHHHCCCCCHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHH
EEKNAAASIMRKPVSLQFRDANVRMVFEALSRTTGLSVIFDRDVRVDLKTTIFVSNASLE
HHHHHHHHHHCCCCEEEEECCCHHHHHHHHHHCCCEEEEEECCEEEEEEEEEEEECCCHH
DTVDMILLQNQLAKKVLNANTVFIYPATPAKQQEYQDLKVRTFQLSNTDAKHIDTLLKNL
HHHHHHHHHHHHHHHHHCCCEEEEEECCCCCHHHHCCCEEEEEEECCCCHHHHHHHHHHH
LKIKEIVTDERANTVSIRATPETIRVAERMIAAQDLPEPEVMLEVEVLEVSRDRLTDLGI
HHHHHHHHCCCCCEEEEEECHHHHHHHHHHHHHHCCCCCCEEEEEEEEHHHHHHHHHCCC
DWPNSFSLGTPSSASTWGALHHLTVNQLTASGLSVTANLKLTDTDANLLASPRIRTRNKE
CCCCCCCCCCCCCCCHHHHHHEEEHHHHHCCCCEEEEEEEEECCCCCCEECCCCCCCCCC
KAKILIGDKVPVISSSSVPSTSGPVYSQSIQYLDVGIKLEVEPQVYRDNDVGIKMSLEVS
CEEEEECCCCCEEECCCCCCCCCCCHHCCEEEEEEEEEEEECCCEEECCCCCEEEEEEHH
NITQIISSSNAQTGLSSLAYQIGTRNASTTLRLKDGETQILGGLIQDEDRDAANKVPGLG
HHHHHHHCCCHHHHHHHHHHHHCCCCCCEEEEEECCCHHHHHHHHCCCCCCHHHCCCCCC
QLPVLGRLFSNHNGDHKKTEIVLQITPHIVRPQLAADADTREIWSGTDSTVRTEQLRLDP
CCHHHHHHHHCCCCCCCEEEEEEEECCCHHCCCHHCCCCHHHHHCCCCCCEEEEEEEECC
PGVAAPATPAAPAAPAAALPAPAAGVAVVSPGAVGGGTTGGEQTPKAAAPAAAGGVVPPN
CCCCCCCCCCCCCCCCCCCCCCCCCEEEECCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC
GAFGQPPAAPRTTPPPAMFGGRFMTTVPPPEGVVPPAPPAPAAAPAAVAAPAAAAPAAPA
CCCCCCCCCCCCCCCCHHHCCEEEEECCCCCCCCCCCCCCCCCCCHHHHCCCCCCCCCCC
AGTAGPEAAAAVSPTEAAPPAPAPAAPYTPAPAAPAAAPPAASPPPIVPTPPSDMPSDNP
CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCC
LHPIPTGAY
CCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 1916268; 7542800; 1856167 [H]