Definition Candidatus Solibacter usitatus Ellin6076 chromosome, complete genome.
Accession NC_008536
Length 9,965,640

Click here to switch to the map view.

The map label for this gene is pilC [H]

Identifier: 116626806

GI number: 116626806

Start: 9762364

End: 9763578

Strand: Direct

Name: pilC [H]

Synonym: Acid_7779

Alternate gene names: 116626806

Gene position: 9762364-9763578 (Clockwise)

Preceding gene: 116626805

Following gene: 116626807

Centisome position: 97.96

GC content: 63.7

Gene sequence:

>1215_bases
ATGGCCACCACCTTCTTCTTCCGCGCCGTGGCCTCCGACGGCAAAGTCCGCACCGGAAGCCTCGCCGGCGCCGACGAGAA
ACTCGTGGTCCGCGAACTCCGCAAACAGGGACTCACCCCCATCTACGTCGGTGTCGCTCCCAAGAGCGCCGGCGTCGAAC
TCAAGCTGCCCTCCTTCCGCAAGGGCCGCCGCCGCGACATTCTCTTTTTCACGCAGGAGCTTTCCACTCTCCTCAACGCC
GGCGTGCCGCTCGATCGCTCCCTGAGCATCACCGCCGAGCTCACCGAAAAACCCGCCTTCCGCTTCATCGTCCTCGACGT
GCTCCGCGTCCTCAAAGGCGGCCGCACCTTGGCCGATAGTCTGGCCACGCACCCCGAGTACTTCAGCGATCTCTACGTCA
ACATGGTGCGCGCGGGGGAAGCCTCGGGCGCGCTCGCCATCATCTTCGAGCGCCTCGCCGAGTTCGAACGCACCCGCGAC
GACCTGCGCAACTACATCATCTCTTCGATGATCTATCCCGCGCTGCTCGCCTGCGTCGGCCTGGCCTCCATCACGCTGCT
GTTGACCTTCGTGGTGCCGCGCTTCGCCACCATCTTCAGCGATTCCACCATGAAGATCCCGCTGCCCACCAAAATCATGC
TGGACGTCAGCAACGTGGTCACGGCTTGGTGGTGGGTTGCCGCGCTCGCCATCGCGATCACGCTGATCGTCTGGCGTGTT
TATACCAAGACTCCCGCGGGCCACCTCTGGTGGGACGGTGCACGCCTCAAACTACCTTTGCTCGGCGACGCACTGTTGAA
GGCGGAAACGGCGCGCTTCGCCCGCGCCATGGGGACGCTCGTCGGCAACTCCGTGCCGCTGGTGCAATCGCTCGGCATCG
CCGCCGCGACGCTCAACAACCGCACGATCTCGGGCGCGCTGGTCGGAGTCGCGATGGGCGTCAAGCGCGGTGAAGGCATC
GCGGCGCCGATGCGCAAAGCCGGGGTCTTTCCGCCGCTCGCCGCACACCTCCTGACCGTGGGCGAAGAGACCGGCAAACT
GGACAGCATGTTTATCCGGATGGCGGATATCTACGAAACCGATACCCGCGCCGCCATCAAGCGCTTCACCTCAATCTTCG
AACCGGTGGTGATCCTGGTGATGGGCGTCTTGATCGGCGCACTGATTTTGAGTATGCTGCTCGCGATTACGAGCATTAAC
GACGTGGCGGTATAA

Upstream 100 bases:

>100_bases
CATCGCCCCCCAACGAGCCGCGACCGTCAGGGAGCGCCGAGCCCTCGCCCCCTCGCATCGCCCCCGCCGCGATTCGCGAC
CGTCTTGGAGCCCCCTCTAA

Downstream 100 bases:

>100_bases
CATGACGAAAACTACGAAACGCAATCGCAGACGCTCCTCCCGGGCCGGTGTCACACTCATTGAAATGCTGGTGGTGGTGA
CCATCATCGGCCTTTTTGTA

Product: type II secretion system protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 404; Mature: 403

Protein sequence:

>404_residues
MATTFFFRAVASDGKVRTGSLAGADEKLVVRELRKQGLTPIYVGVAPKSAGVELKLPSFRKGRRRDILFFTQELSTLLNA
GVPLDRSLSITAELTEKPAFRFIVLDVLRVLKGGRTLADSLATHPEYFSDLYVNMVRAGEASGALAIIFERLAEFERTRD
DLRNYIISSMIYPALLACVGLASITLLLTFVVPRFATIFSDSTMKIPLPTKIMLDVSNVVTAWWWVAALAIAITLIVWRV
YTKTPAGHLWWDGARLKLPLLGDALLKAETARFARAMGTLVGNSVPLVQSLGIAAATLNNRTISGALVGVAMGVKRGEGI
AAPMRKAGVFPPLAAHLLTVGEETGKLDSMFIRMADIYETDTRAAIKRFTSIFEPVVILVMGVLIGALILSMLLAITSIN
DVAV

Sequences:

>Translated_404_residues
MATTFFFRAVASDGKVRTGSLAGADEKLVVRELRKQGLTPIYVGVAPKSAGVELKLPSFRKGRRRDILFFTQELSTLLNA
GVPLDRSLSITAELTEKPAFRFIVLDVLRVLKGGRTLADSLATHPEYFSDLYVNMVRAGEASGALAIIFERLAEFERTRD
DLRNYIISSMIYPALLACVGLASITLLLTFVVPRFATIFSDSTMKIPLPTKIMLDVSNVVTAWWWVAALAIAITLIVWRV
YTKTPAGHLWWDGARLKLPLLGDALLKAETARFARAMGTLVGNSVPLVQSLGIAAATLNNRTISGALVGVAMGVKRGEGI
AAPMRKAGVFPPLAAHLLTVGEETGKLDSMFIRMADIYETDTRAAIKRFTSIFEPVVILVMGVLIGALILSMLLAITSIN
DVAV
>Mature_403_residues
ATTFFFRAVASDGKVRTGSLAGADEKLVVRELRKQGLTPIYVGVAPKSAGVELKLPSFRKGRRRDILFFTQELSTLLNAG
VPLDRSLSITAELTEKPAFRFIVLDVLRVLKGGRTLADSLATHPEYFSDLYVNMVRAGEASGALAIIFERLAEFERTRDD
LRNYIISSMIYPALLACVGLASITLLLTFVVPRFATIFSDSTMKIPLPTKIMLDVSNVVTAWWWVAALAIAITLIVWRVY
TKTPAGHLWWDGARLKLPLLGDALLKAETARFARAMGTLVGNSVPLVQSLGIAAATLNNRTISGALVGVAMGVKRGEGIA
APMRKAGVFPPLAAHLLTVGEETGKLDSMFIRMADIYETDTRAAIKRFTSIFEPVVILVMGVLIGALILSMLLAITSIND
VAV

Specific function: Involved in the translocation of the type IV pilin (pilA) [H]

COG id: COG1459

COG function: function code NU; Type II secretory pathway, component PulF

Gene ontology:

Cell location: Cell inner membrane; Multi-pass membrane protein (Probable) [H]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the GSP F family [H]

Homologues:

Organism=Escherichia coli, GI1789724, Length=400, Percent_Identity=28.25, Blast_Score=197, Evalue=1e-51,
Organism=Escherichia coli, GI1786295, Length=396, Percent_Identity=22.2222222222222, Blast_Score=112, Evalue=4e-26,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR003004
- InterPro:   IPR018076
- InterPro:   IPR001992 [H]

Pfam domain/function: PF00482 GSPII_F [H]

EC number: NA

Molecular weight: Translated: 43836; Mature: 43705

Theoretical pI: Translated: 10.34; Mature: 10.34

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.2 %Cys     (Translated Protein)
3.0 %Met     (Translated Protein)
3.2 %Cys+Met (Translated Protein)
0.2 %Cys     (Mature Protein)
2.7 %Met     (Mature Protein)
3.0 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MATTFFFRAVASDGKVRTGSLAGADEKLVVRELRKQGLTPIYVGVAPKSAGVELKLPSFR
CCCHHHHHHHHCCCCEEECCCCCCCHHHHHHHHHHCCCCEEEEEECCCCCCCEEECCCCC
KGRRRDILFFTQELSTLLNAGVPLDRSLSITAELTEKPAFRFIVLDVLRVLKGGRTLADS
CCCCCHHHHHHHHHHHHHHCCCCCCCCCEEEEEHHCCCHHHHHHHHHHHHHHCCCHHHHH
LATHPEYFSDLYVNMVRAGEASGALAIIFERLAEFERTRDDLRNYIISSMIYPALLACVG
HHCCHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
LASITLLLTFVVPRFATIFSDSTMKIPLPTKIMLDVSNVVTAWWWVAALAIAITLIVWRV
HHHHHHHHHHHHHHHHHHHCCCEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
YTKTPAGHLWWDGARLKLPLLGDALLKAETARFARAMGTLVGNSVPLVQSLGIAAATLNN
HHCCCCCCEEECCCEEEECHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHCCHHHEECCC
RTISGALVGVAMGVKRGEGIAAPMRKAGVFPPLAAHLLTVGEETGKLDSMFIRMADIYET
CCHHHHHHHHHHHCCCCCCCCCCHHHCCCCCHHHHHHHHHCCCCCCHHHHHHHHHHHHCC
DTRAAIKRFTSIFEPVVILVMGVLIGALILSMLLAITSINDVAV
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCC
>Mature Secondary Structure 
ATTFFFRAVASDGKVRTGSLAGADEKLVVRELRKQGLTPIYVGVAPKSAGVELKLPSFR
CCHHHHHHHHCCCCEEECCCCCCCHHHHHHHHHHCCCCEEEEEECCCCCCCEEECCCCC
KGRRRDILFFTQELSTLLNAGVPLDRSLSITAELTEKPAFRFIVLDVLRVLKGGRTLADS
CCCCCHHHHHHHHHHHHHHCCCCCCCCCEEEEEHHCCCHHHHHHHHHHHHHHCCCHHHHH
LATHPEYFSDLYVNMVRAGEASGALAIIFERLAEFERTRDDLRNYIISSMIYPALLACVG
HHCCHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
LASITLLLTFVVPRFATIFSDSTMKIPLPTKIMLDVSNVVTAWWWVAALAIAITLIVWRV
HHHHHHHHHHHHHHHHHHHCCCEEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
YTKTPAGHLWWDGARLKLPLLGDALLKAETARFARAMGTLVGNSVPLVQSLGIAAATLNN
HHCCCCCCEEECCCEEEECHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHCCHHHEECCC
RTISGALVGVAMGVKRGEGIAAPMRKAGVFPPLAAHLLTVGEETGKLDSMFIRMADIYET
CCHHHHHHHHHHHCCCCCCCCCCHHHCCCCCHHHHHHHHHCCCCCCHHHHHHHHHHHHCC
DTRAAIKRFTSIFEPVVILVMGVLIGALILSMLLAITSINDVAV
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 1971619; 10984043 [H]