Definition Geobacter sulfurreducens PCA chromosome, complete genome.
Accession NC_002939
Length 3,814,139

Click here to switch to the map view.

The map label for this gene is pilJ [H]

Identifier: 39995690

GI number: 39995690

Start: 615706

End: 617322

Strand: Reverse

Name: pilJ [H]

Synonym: GSU0583

Alternate gene names: 39995690

Gene position: 617322-615706 (Counterclockwise)

Preceding gene: 308513284

Following gene: 39995672

Centisome position: 16.19

GC content: 62.28

Gene sequence:

>1617_bases
ATGGCGCTTAACTATGCACCAGCAGCCGGCTACGACAGGGGACATGCGCACCTTCTGGCGGGCATGCTCGGGTGCAACGC
CCTGCTGTCGCTCTTCGCCCTCTGGATGCTTTCCGCCAGAAAACTGGTGGTTCGTGTCAACAATCTGGCATCTGCCATGG
ACCGCGGCGCCGAAGGAGACCTCACGGTCACCGTCACTGATGAATCGTCCGACGAACTCGGGCAGCTAACCGACAACTTT
AATGCCATGTTCGGCCGCCTGGCGGGCATGGTCACCCGGGTCAAGGAGGCCGTCGAAGAGCTGCGGGCCATCTCGGCCAC
GGTCAAGGACGCGGTTGAGCGTGGGCTCGACACGGCGGAAGTCCAGACAGGGGCAGTGCAGCGGACGACCGACGGCATCC
GCGCCATCGACCGGTCGGTGAACGAGGTCGCCCAGTCGGTGGAAAGCCTGTCGCGCACGGCCTCCGAGAATGCCGCCGCC
ATCGTCCAGATGTCAACGAGCATCGAGGTGGTGGCGGAGCACATGGAAGGGCTTGCCCGGGAGGTAGACGAGGTGAGTTC
ATCCATCATCCAGATGGCGGCTGCGGAAAAGGAAATAGGCAGAAGCGTCCGGGTGCTCATGGAGGATGCGTCCCGCACCG
CCTCGCTCGTTGCCGAAATGGATCTGTCCATCAGGCAGGTGGAGAAAAGCGCCCTGGAAACCGCCGCCATTTCGGAAGAA
GTGCTGCGCGATGCGGAACTGGGACGTGACTCGGTTGACCGGACCATCTCGGGCATCAGCGAGATCCGCCGTTCCTCCCG
CAGTGCCTCTGACACCATTACCACCCTCTCCCACCGGGTCGGCGACATCGGCACCATCATCTCGGTCATCAACGAAATCG
CGGAGCAGACCAAGCTCCTGGCCCTCAATGCCTCCATCATCGCAGCCCAAGCCGGGGAACACGGCAAGGGTTTCGCCGTG
GTGGCGAACGAAATCAAGGAACTTGCCAAACGGACCACCAGTTCCACCGGAGAAATCGCAGAAATCATCTCGGGACTCCG
GGAGGAAACGGTTCGGGCGGTTCAGGCCATCAAGCAGGCGGAAGACCGGATCGGCGAGGGGGAAACGCTCTCCTACCGTT
CGGGTGAGGCGCTCGAAAAGATCGTGGACGGGGTGAAAATGGCGGTCGACCAGGTGGGCGAGATCGCGCGGACGACCGTT
GAGCAGGCCCAGGGCAGCGAAAATATGCGCCGGGCCATGGAACGGGTTGCGGAAATGGTCGAGCAGATCATGCGCGCCAC
CCAGGAGCAGGCCCACGGCACCGAGTTGATCACCGAGGCTGCGGACCGCATGAAGAGCCTCACGGGGCGCGTCTTCAGTT
CCACCCGGGAACAGCGCGATACCAGTACCCACATCGTCCGCTCCAGTGAAGGTGTGACGCACATGATCTCAACCATCCGC
CAGGCATCCCAGGTTCAGGCGGAAAACAGCCAGAAGATCGTTGAAGCAGTTGAAAACATGGAGACTACTGCGGTCAACGG
TCTCGATACGACCCGGCTCATGGAAGAGGCCGTCTCCCGACTTGCGCGCCAGACAGAAGGGCTCACCGAGGCCATGGCCG
GCTTCAAGGTCCGGTAA

Upstream 100 bases:

>100_bases
ATACCGGGAGATTGCCGTGGCAAAGAATCTCAGCCTGGGGTCCAGACTCATTCGTTTCTCGCTCACCGCCGGCTTTATCG
TGGGAACGGCGGGAGCAGTC

Downstream 100 bases:

>100_bases
CCGGAGCCGGCCTCAATCGTCGGCCCGGTAGCCGATCCTCACGGCACCCCAGTGCCTGCCGCCGATAACAATCGGCACTG
AAAGGTCATTCATCACCTCG

Product: methyl-accepting chemotaxis protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 538; Mature: 537

Protein sequence:

>538_residues
MALNYAPAAGYDRGHAHLLAGMLGCNALLSLFALWMLSARKLVVRVNNLASAMDRGAEGDLTVTVTDESSDELGQLTDNF
NAMFGRLAGMVTRVKEAVEELRAISATVKDAVERGLDTAEVQTGAVQRTTDGIRAIDRSVNEVAQSVESLSRTASENAAA
IVQMSTSIEVVAEHMEGLAREVDEVSSSIIQMAAAEKEIGRSVRVLMEDASRTASLVAEMDLSIRQVEKSALETAAISEE
VLRDAELGRDSVDRTISGISEIRRSSRSASDTITTLSHRVGDIGTIISVINEIAEQTKLLALNASIIAAQAGEHGKGFAV
VANEIKELAKRTTSSTGEIAEIISGLREETVRAVQAIKQAEDRIGEGETLSYRSGEALEKIVDGVKMAVDQVGEIARTTV
EQAQGSENMRRAMERVAEMVEQIMRATQEQAHGTELITEAADRMKSLTGRVFSSTREQRDTSTHIVRSSEGVTHMISTIR
QASQVQAENSQKIVEAVENMETTAVNGLDTTRLMEEAVSRLARQTEGLTEAMAGFKVR

Sequences:

>Translated_538_residues
MALNYAPAAGYDRGHAHLLAGMLGCNALLSLFALWMLSARKLVVRVNNLASAMDRGAEGDLTVTVTDESSDELGQLTDNF
NAMFGRLAGMVTRVKEAVEELRAISATVKDAVERGLDTAEVQTGAVQRTTDGIRAIDRSVNEVAQSVESLSRTASENAAA
IVQMSTSIEVVAEHMEGLAREVDEVSSSIIQMAAAEKEIGRSVRVLMEDASRTASLVAEMDLSIRQVEKSALETAAISEE
VLRDAELGRDSVDRTISGISEIRRSSRSASDTITTLSHRVGDIGTIISVINEIAEQTKLLALNASIIAAQAGEHGKGFAV
VANEIKELAKRTTSSTGEIAEIISGLREETVRAVQAIKQAEDRIGEGETLSYRSGEALEKIVDGVKMAVDQVGEIARTTV
EQAQGSENMRRAMERVAEMVEQIMRATQEQAHGTELITEAADRMKSLTGRVFSSTREQRDTSTHIVRSSEGVTHMISTIR
QASQVQAENSQKIVEAVENMETTAVNGLDTTRLMEEAVSRLARQTEGLTEAMAGFKVR
>Mature_537_residues
ALNYAPAAGYDRGHAHLLAGMLGCNALLSLFALWMLSARKLVVRVNNLASAMDRGAEGDLTVTVTDESSDELGQLTDNFN
AMFGRLAGMVTRVKEAVEELRAISATVKDAVERGLDTAEVQTGAVQRTTDGIRAIDRSVNEVAQSVESLSRTASENAAAI
VQMSTSIEVVAEHMEGLAREVDEVSSSIIQMAAAEKEIGRSVRVLMEDASRTASLVAEMDLSIRQVEKSALETAAISEEV
LRDAELGRDSVDRTISGISEIRRSSRSASDTITTLSHRVGDIGTIISVINEIAEQTKLLALNASIIAAQAGEHGKGFAVV
ANEIKELAKRTTSSTGEIAEIISGLREETVRAVQAIKQAEDRIGEGETLSYRSGEALEKIVDGVKMAVDQVGEIARTTVE
QAQGSENMRRAMERVAEMVEQIMRATQEQAHGTELITEAADRMKSLTGRVFSSTREQRDTSTHIVRSSEGVTHMISTIRQ
ASQVQAENSQKIVEAVENMETTAVNGLDTTRLMEEAVSRLARQTEGLTEAMAGFKVR

Specific function: May be a part of a signal-transduction system that regulates twitching motility by controlling pilus function (extension and retraction) [H]

COG id: COG0840

COG function: function code NT; Methyl-accepting chemotaxis protein

Gene ontology:

Cell location: Cell inner membrane; Multi-pass membrane protein (Potential) [H]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 methyl-accepting transducer domain [H]

Homologues:

Organism=Escherichia coli, GI1788194, Length=192, Percent_Identity=36.9791666666667, Blast_Score=95, Evalue=1e-20,
Organism=Escherichia coli, GI1789453, Length=162, Percent_Identity=33.9506172839506, Blast_Score=94, Evalue=3e-20,
Organism=Escherichia coli, GI1788195, Length=219, Percent_Identity=32.4200913242009, Blast_Score=91, Evalue=2e-19,
Organism=Escherichia coli, GI2367378, Length=267, Percent_Identity=31.4606741573034, Blast_Score=86, Evalue=5e-18,
Organism=Escherichia coli, GI1787690, Length=220, Percent_Identity=29.5454545454545, Blast_Score=74, Evalue=2e-14,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR004090
- InterPro:   IPR004089
- InterPro:   IPR003660 [H]

Pfam domain/function: PF00015 MCPsignal [H]

EC number: NA

Molecular weight: Translated: 57994; Mature: 57863

Theoretical pI: Translated: 4.67; Mature: 4.67

Prosite motif: PS50885 HAMP ; PS50111 CHEMOTAXIS_TRANSDUC_2

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.2 %Cys     (Translated Protein)
3.9 %Met     (Translated Protein)
4.1 %Cys+Met (Translated Protein)
0.2 %Cys     (Mature Protein)
3.7 %Met     (Mature Protein)
3.9 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MALNYAPAAGYDRGHAHLLAGMLGCNALLSLFALWMLSARKLVVRVNNLASAMDRGAEGD
CCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCC
LTVTVTDESSDELGQLTDNFNAMFGRLAGMVTRVKEAVEELRAISATVKDAVERGLDTAE
EEEEEECCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHH
VQTGAVQRTTDGIRAIDRSVNEVAQSVESLSRTASENAAAIVQMSTSIEVVAEHMEGLAR
HHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHEEHHHHHHHHHHHHHHHH
EVDEVSSSIIQMAAAEKEIGRSVRVLMEDASRTASLVAEMDLSIRQVEKSALETAAISEE
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
VLRDAELGRDSVDRTISGISEIRRSSRSASDTITTLSHRVGDIGTIISVINEIAEQTKLL
HHHHHHCCHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
ALNASIIAAQAGEHGKGFAVVANEIKELAKRTTSSTGEIAEIISGLREETVRAVQAIKQA
HCCHHHHHHCCCCCCCCHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHH
EDRIGEGETLSYRSGEALEKIVDGVKMAVDQVGEIARTTVEQAQGSENMRRAMERVAEMV
HHHCCCCCEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHH
EQIMRATQEQAHGTELITEAADRMKSLTGRVFSSTREQRDTSTHIVRSSEGVTHMISTIR
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCHHHHHHCCCCCHHHHHHHHH
QASQVQAENSQKIVEAVENMETTAVNGLDTTRLMEEAVSRLARQTEGLTEAMAGFKVR
HHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHCCCCC
>Mature Secondary Structure 
ALNYAPAAGYDRGHAHLLAGMLGCNALLSLFALWMLSARKLVVRVNNLASAMDRGAEGD
CCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCC
LTVTVTDESSDELGQLTDNFNAMFGRLAGMVTRVKEAVEELRAISATVKDAVERGLDTAE
EEEEEECCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHH
VQTGAVQRTTDGIRAIDRSVNEVAQSVESLSRTASENAAAIVQMSTSIEVVAEHMEGLAR
HHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHEEHHHHHHHHHHHHHHHH
EVDEVSSSIIQMAAAEKEIGRSVRVLMEDASRTASLVAEMDLSIRQVEKSALETAAISEE
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
VLRDAELGRDSVDRTISGISEIRRSSRSASDTITTLSHRVGDIGTIISVINEIAEQTKLL
HHHHHHCCHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
ALNASIIAAQAGEHGKGFAVVANEIKELAKRTTSSTGEIAEIISGLREETVRAVQAIKQA
HCCHHHHHHCCCCCCCCHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHH
EDRIGEGETLSYRSGEALEKIVDGVKMAVDQVGEIARTTVEQAQGSENMRRAMERVAEMV
HHHCCCCCEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHH
EQIMRATQEQAHGTELITEAADRMKSLTGRVFSSTREQRDTSTHIVRSSEGVTHMISTIR
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCHHHHHHCCCCCHHHHHHHHH
QASQVQAENSQKIVEAVENMETTAVNGLDTTRLMEEAVSRLARQTEGLTEAMAGFKVR
HHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 7908398; 10984043 [H]