Definition Burkholderia cenocepacia AU 1054 chromosome 1, complete sequence.
Accession NC_008060
Length 3,294,563

Click here to switch to the map view.

The map label for this gene is pilF [H]

Identifier: 107021656

GI number: 107021656

Start: 100432

End: 101718

Strand: Reverse

Name: pilF [H]

Synonym: Bcen_0096

Alternate gene names: 107021656

Gene position: 101718-100432 (Counterclockwise)

Preceding gene: 107021657

Following gene: 107021655

Centisome position: 3.09

GC content: 72.03

Gene sequence:

>1287_bases
GTGCCGGCTCACATGCATTTCCCTTCCCCCGGGGCGCCGCTGCACACGCAGTCGCCGCCCGCGCATTCCGACGCGCCAGC
GGCCGCGCCCCATGCACTCGATGCGGCGCAGCTCGACGATGCCCCCGCCGTACGCCTGCTGACGGATACGCTACACGCGG
CGCGTGTGCGCGACGCGTCGGACATCCACGTCGAGCCATTCGAGGCCGGCTGGCGCATCCGTCTGCGCATCGACGGCGTG
CTGCATGAACATGCGCGACCGCCGCTGCACCTGCGCGATGCGCTCGTCACGCGGATCAAGGTGCTCTCGCGCATGGACAT
CGCCGAGCGGCGGCTTCCGCAGGACGGCCGGCTGCGCATCGCGATCGACGGCGGCACGCGCGGCGACTACCGCGTCAGCT
CGCTGCCCACGCTGTTCGGCGAAAAGCTCGTGCTGCGGCGACTCGAAACGCTGCCGCCCGATCTCACGCTTGCCAACCTC
GGCTTCGACGCGCGGCAGGCCGCCGCGATGGAGGCCGCGATCCGCGCGCCGCATGGCCTCGTGCTCGTCACGGGCCCGAC
CGGCAGCGGCAAGACGCTGTCGCTCTACTGCGCGCTGCAGATGCTCGATCGCGACGCGCACAACGTCTGCACGGTGGAAG
ATCCCGCCGAAATCCAGCTCGACGGGATCAACCAGGTGGGAGTCGCCGACAAGGCGGGGCTCACGTTCGCGACGGCGCTG
CGCGCGCTGTTGCGGCAGGACCCGGACGTCATCATGGTCGGCGAGATTCGCGATGCGGAAACGGCCGATGTCGCGATCAA
GGCCGCGCAGACCGGTCATCTCGTGCTGTCGACCCTGCACACGAACGACGCGCCGGCGGCCGTCGCGCGGCTGCTCGACA
TCGGCGTCGCGCCATACAACCTCGCGGCCGCGCTGCACCTCGTCACCGCGCAGCGTCTCGTCCGGCGCCTGTGCGTCGCG
TGCCGCGTGCATTCGGACGCATCGGCGCACGCGCTGCGGGAAGCCGGCTGCGACCCGGCGGCGCTGGCAGCCGGATGGCG
GCCGTTCGTCGCGCGCGGCTGTTCCGCCTGTCACGGCATCGGCTATCGCGGCCGCATCGGCCTGCATCAGACGATGCCGG
TATCGCCCGGGCTGGCCGAGCGCATCGTCGCGCGGGCGAGCGTCGGCGAGCTCGCGCAATGCGTGGCGGCCGAGGGCGTG
CGCAGCCTGCGCGACGCGGCATTCGCGCGCGTCCTGGACGGCACGACGAGCATCGCGGAAGCCGTCGCCGCCACACCTGC
GGCATGA

Upstream 100 bases:

>100_bases
CGCGTACCGGACGCACCGCCACGCGCTAACCGAACGGCCGACTGCCGGTGCCGGCCGCGACGCGCGATCATCTGCGCATC
ACGGTCAACAGGCGGCCCGC

Downstream 100 bases:

>100_bases
GCATGCGCACGCCACCGCGCGAAACCCGCTTTGCATGGCGCGGCCGCCGTCGCGACGGCTCGCCCCGCCGCGGGACCGTC
ATCGCCTTCGACGCCGCGGC

Product: type II secretion system protein E

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 428; Mature: 427

Protein sequence:

>428_residues
MPAHMHFPSPGAPLHTQSPPAHSDAPAAAPHALDAAQLDDAPAVRLLTDTLHAARVRDASDIHVEPFEAGWRIRLRIDGV
LHEHARPPLHLRDALVTRIKVLSRMDIAERRLPQDGRLRIAIDGGTRGDYRVSSLPTLFGEKLVLRRLETLPPDLTLANL
GFDARQAAAMEAAIRAPHGLVLVTGPTGSGKTLSLYCALQMLDRDAHNVCTVEDPAEIQLDGINQVGVADKAGLTFATAL
RALLRQDPDVIMVGEIRDAETADVAIKAAQTGHLVLSTLHTNDAPAAVARLLDIGVAPYNLAAALHLVTAQRLVRRLCVA
CRVHSDASAHALREAGCDPAALAAGWRPFVARGCSACHGIGYRGRIGLHQTMPVSPGLAERIVARASVGELAQCVAAEGV
RSLRDAAFARVLDGTTSIAEAVAATPAA

Sequences:

>Translated_428_residues
MPAHMHFPSPGAPLHTQSPPAHSDAPAAAPHALDAAQLDDAPAVRLLTDTLHAARVRDASDIHVEPFEAGWRIRLRIDGV
LHEHARPPLHLRDALVTRIKVLSRMDIAERRLPQDGRLRIAIDGGTRGDYRVSSLPTLFGEKLVLRRLETLPPDLTLANL
GFDARQAAAMEAAIRAPHGLVLVTGPTGSGKTLSLYCALQMLDRDAHNVCTVEDPAEIQLDGINQVGVADKAGLTFATAL
RALLRQDPDVIMVGEIRDAETADVAIKAAQTGHLVLSTLHTNDAPAAVARLLDIGVAPYNLAAALHLVTAQRLVRRLCVA
CRVHSDASAHALREAGCDPAALAAGWRPFVARGCSACHGIGYRGRIGLHQTMPVSPGLAERIVARASVGELAQCVAAEGV
RSLRDAAFARVLDGTTSIAEAVAATPAA
>Mature_427_residues
PAHMHFPSPGAPLHTQSPPAHSDAPAAAPHALDAAQLDDAPAVRLLTDTLHAARVRDASDIHVEPFEAGWRIRLRIDGVL
HEHARPPLHLRDALVTRIKVLSRMDIAERRLPQDGRLRIAIDGGTRGDYRVSSLPTLFGEKLVLRRLETLPPDLTLANLG
FDARQAAAMEAAIRAPHGLVLVTGPTGSGKTLSLYCALQMLDRDAHNVCTVEDPAEIQLDGINQVGVADKAGLTFATALR
ALLRQDPDVIMVGEIRDAETADVAIKAAQTGHLVLSTLHTNDAPAAVARLLDIGVAPYNLAAALHLVTAQRLVRRLCVAC
RVHSDASAHALREAGCDPAALAAGWRPFVARGCSACHGIGYRGRIGLHQTMPVSPGLAERIVARASVGELAQCVAAEGVR
SLRDAAFARVLDGTTSIAEAVAATPAA

Specific function: Involved in the translocation of the type IV pilin [H]

COG id: COG2804

COG function: function code NU; Type II secretory pathway, ATPase PulE/Tfp pilus assembly pathway, ATPase PilB

Gene ontology:

Cell location: Cytoplasm (Probable) [H]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the GSP E family [H]

Homologues:

Organism=Escherichia coli, GI1789723, Length=382, Percent_Identity=45.0261780104712, Blast_Score=314, Evalue=8e-87,
Organism=Escherichia coli, GI1786296, Length=388, Percent_Identity=46.3917525773196, Blast_Score=309, Evalue=2e-85,
Organism=Escherichia coli, GI87082188, Length=268, Percent_Identity=35.4477611940299, Blast_Score=112, Evalue=4e-26,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR003593
- InterPro:   IPR013374
- InterPro:   IPR007831
- InterPro:   IPR001482 [H]

Pfam domain/function: PF00437 GSPII_E; PF05157 GSPII_E_N [H]

EC number: NA

Molecular weight: Translated: 45303; Mature: 45172

Theoretical pI: Translated: 7.31; Mature: 7.31

Prosite motif: PS51007 CYTC ; PS00662 T2SP_E

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.9 %Cys     (Translated Protein)
1.6 %Met     (Translated Protein)
3.5 %Cys+Met (Translated Protein)
1.9 %Cys     (Mature Protein)
1.4 %Met     (Mature Protein)
3.3 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MPAHMHFPSPGAPLHTQSPPAHSDAPAAAPHALDAAQLDDAPAVRLLTDTLHAARVRDAS
CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHCCCCCHHHHHHHHHHHHHCCCCC
DIHVEPFEAGWRIRLRIDGVLHEHARPPLHLRDALVTRIKVLSRMDIAERRLPQDGRLRI
CCEEEECCCCCEEEEEECCHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCCEEE
AIDGGTRGDYRVSSLPTLFGEKLVLRRLETLPPDLTLANLGFDARQAAAMEAAIRAPHGL
EEECCCCCCEEHHHCHHHHHHHHHHHHHHHCCCCCEEECCCCCHHHHHHHHHHHCCCCCE
VLVTGPTGSGKTLSLYCALQMLDRDAHNVCTVEDPAEIQLDGINQVGVADKAGLTFATAL
EEEECCCCCCCEEEHHHHHHHHCCCCCCEEECCCCCEEEECCCCCCCCCCCCCHHHHHHH
RALLRQDPDVIMVGEIRDAETADVAIKAAQTGHLVLSTLHTNDAPAAVARLLDIGVAPYN
HHHHHCCCCEEEEECCCCCCCCCEEEEECCCCCEEEEEECCCCHHHHHHHHHHHCCCCHH
LAAALHLVTAQRLVRRLCVACRVHSDASAHALREAGCDPAALAAGWRPFVARGCSACHGI
HHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHCCCCHHHHHCCCHHHHHHHHHHHHCC
GYRGRIGLHQTMPVSPGLAERIVARASVGELAQCVAAEGVRSLRDAAFARVLDGTTSIAE
CCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHH
AVAATPAA
HHHCCCCC
>Mature Secondary Structure 
PAHMHFPSPGAPLHTQSPPAHSDAPAAAPHALDAAQLDDAPAVRLLTDTLHAARVRDAS
CCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCHHHCCCCCHHHHHHHHHHHHHCCCCC
DIHVEPFEAGWRIRLRIDGVLHEHARPPLHLRDALVTRIKVLSRMDIAERRLPQDGRLRI
CCEEEECCCCCEEEEEECCHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCCEEE
AIDGGTRGDYRVSSLPTLFGEKLVLRRLETLPPDLTLANLGFDARQAAAMEAAIRAPHGL
EEECCCCCCEEHHHCHHHHHHHHHHHHHHHCCCCCEEECCCCCHHHHHHHHHHHCCCCCE
VLVTGPTGSGKTLSLYCALQMLDRDAHNVCTVEDPAEIQLDGINQVGVADKAGLTFATAL
EEEECCCCCCCEEEHHHHHHHHCCCCCCEEECCCCCEEEECCCCCCCCCCCCCHHHHHHH
RALLRQDPDVIMVGEIRDAETADVAIKAAQTGHLVLSTLHTNDAPAAVARLLDIGVAPYN
HHHHHCCCCEEEEECCCCCCCCCEEEEECCCCCEEEEEECCCCHHHHHHHHHHHCCCCHH
LAAALHLVTAQRLVRRLCVACRVHSDASAHALREAGCDPAALAAGWRPFVARGCSACHGI
HHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHCCCCHHHHHCCCHHHHHHHHHHHHCC
GYRGRIGLHQTMPVSPGLAERIVARASVGELAQCVAAEGVRSLRDAAFARVLDGTTSIAE
CCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHH
AVAATPAA
HHHCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 8100347 [H]