Definition Synechococcus sp. PCC 7002 chromosome, complete genome.
Accession NC_010475
Length 3,008,047

Click here to switch to the map view.

The map label for this gene is gspE [H]

Identifier: 170077319

GI number: 170077319

Start: 726189

End: 728210

Strand: Direct

Name: gspE [H]

Synonym: SYNPCC7002_A0696

Alternate gene names: 170077319

Gene position: 726189-728210 (Clockwise)

Preceding gene: 170077306

Following gene: 170077320

Centisome position: 24.14

GC content: 50.74

Gene sequence:

>2022_bases
ATGACCCACTCTTCCCTTCCCAAACGGACAAGAGCCCTTGCCCTCCGCAATGATTTCTCTCCTTTCGGCAACAAGCTCAT
TCAACAGGGAGTTGTAGACCATCAACAGATGGAAAAAGCCCTCGTTGAAACCCGGCGTAGTGGACGCCCCCTCACGGCCA
TTGTCGAAGAACTAACCGGGAAAGCCCTGTCCCCTGAGCTAGTCCGACAGTACAAAAAGCATCATCTCTTTGAACTGAAG
ATCCTCTACGGTCTCAATTCCATTGACCCAGAAGTTCAAAAAATTGACATCGATCAGATGGGCGAGTTGATCAATTCCCT
CGTGCCCGTAGAATTATGTCGCCGCCACCGTCTCCTTCCGATCCGGCGGGTTCAAGATGAAGTGATTGTGGCGATGGTAG
AGCCCGATAACCTAGCCGCCCAAGATGATTTAAACCGTCTTTTTCGCCTGCAAAATCTGACGTTACGGCGCATCGTGATC
ACAGAAGACGACTATCGTCAGGTGCTAGATGGCTATTTAGAACAGCAAGTCCAGATTCAAATCCAACAGCAGGAACAAGC
AGCCAAGGCCGCCGAAGCAGCAGAACTGAAAAAAGCAGTTGATATCGAAGATCTTGATCTCGGTGTAGCCGGGGAATTAG
ACGAGCAGGAAGAAGAAAGCGCCGACCTGATGAATGAAAATCAGGCTAGCTCTGCTCCGGTGATCAAACTTGTCAATAAA
GTGCTACTTAAAGCTCTCCAGGAAGGGGCCTCAGATATTCACATCGAACCCCAAGAAAATGATCTGCGGATTCGTTTCCG
TAAAGATGGGGTTCTGCAATATGCTTTTGATCCGCTGCCCAAACGGATTGTGCCGGCGGTAACGGCCCGGTTTAAAATTA
TGGCGGACCTAGACATTGCGGAACGTCGTGTACCTCAGGATGGTCGGATTCGGCGGATGTTTAAGGGGCGCAAGGTGGAC
TTTCGGGTCAATAGCTTACCCAGTCGCTACGGCGAAAAAATTGTTTTACGGATTCTCGATAATTCTTCAACCCAGTTGGG
CTTGGATTTGTTAATTACCAACCAAAATATTCTGGGGCAGGTGCGGGAAATGGCCCAGCGGCCATTTGGTCTAATTTTGG
TGACGGGGCCAACAGGCTCAGGAAAATCAACAACTTTGTATTCAATTCTGGCGGAGCGCAACGAGCCGGGCATCAACATC
AGTACCGCAGAAGACCCCATTGAATATACTTTGCCGGGCATTACCCAGGTGCAGGTCATCCGGGAAAAGGGGATGGATTT
TGCGTCAATTTTGCGGGCATTTTTGCGGCAGGATCCAGATGTCATTCTTGTGGGAGAAACCCGGGATAAGGAAACGGCAA
AAACAGCCATTGAGGCGGCTTTAACGGGGCACTTGGTACTAACGACTCTCCACACCAATGATGCTCCAGGGGCGATCGCC
CGTCTAGATGAGATGGGAGTTGAACCCTTTATGATTTCCGGGTCACTCCTGGGAGTTCTGGCCCAGCGCTTGATGCGACG
GGTTTGTGGGGAATGCCGCATCCCCTATCAGCCCACAGTGGAAGAGCTGGCACGCTACGGCCTTTCCAGTAATGATCGCC
ATCCTTTAACGGTGTACCGGGCCAATACCCTGACGCCAGAGCAAATCCAAATGGCCAAAGAAGCCGGCAGTCTCTGTCCT
AAATGTGGCGGCGGCGGCTACAAAGGCCGGGTGGGGGTCTATGAGTTTATGCAAAATAGTGAAGAAATTGAACGGTTGAT
TAATACCGGGGCCACCACGGACATGATCAAAGAAGTGGCAGTGCAAGAGGGCATGTTGAGTATCTTGGCCTACAGTTTGG
AGTTGGTCAAAGAAGGCCATACGACCTTTGAGGAGGTAGACCGTGTTACCTTTACTGATTCTGGCCTTGAGGCAGAACTA
AAGGCGAAACGAAAGACGGGCTTGGTTTGTGACACCTGTAATGCTGAGTTGCAGCCGGATTGGCTAGATTGTCCCTACTG
TATGACGCCCCGCTTTAGTTAA

Upstream 100 bases:

>100_bases
ATTCAGCATTGAACTACGAATCATCATATTGCCAACAACTATCCCGCTTTTCTTTTTTGCCTAGTCTGCCGTCATTTGCC
AATGCTGTCTGGTTTTTCCT

Downstream 100 bases:

>100_bases
GACTCTTCACTCTCTGTTCCCTGGCGATCGCCTTTTGGGCAGAATAATGGCAGCGACAATCTTTCACCCCAACTTTTTTC
TTTCCTATCCCAGGCGATCG

Product: general secretion pathway protein E

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 673; Mature: 672

Protein sequence:

>673_residues
MTHSSLPKRTRALALRNDFSPFGNKLIQQGVVDHQQMEKALVETRRSGRPLTAIVEELTGKALSPELVRQYKKHHLFELK
ILYGLNSIDPEVQKIDIDQMGELINSLVPVELCRRHRLLPIRRVQDEVIVAMVEPDNLAAQDDLNRLFRLQNLTLRRIVI
TEDDYRQVLDGYLEQQVQIQIQQQEQAAKAAEAAELKKAVDIEDLDLGVAGELDEQEEESADLMNENQASSAPVIKLVNK
VLLKALQEGASDIHIEPQENDLRIRFRKDGVLQYAFDPLPKRIVPAVTARFKIMADLDIAERRVPQDGRIRRMFKGRKVD
FRVNSLPSRYGEKIVLRILDNSSTQLGLDLLITNQNILGQVREMAQRPFGLILVTGPTGSGKSTTLYSILAERNEPGINI
STAEDPIEYTLPGITQVQVIREKGMDFASILRAFLRQDPDVILVGETRDKETAKTAIEAALTGHLVLTTLHTNDAPGAIA
RLDEMGVEPFMISGSLLGVLAQRLMRRVCGECRIPYQPTVEELARYGLSSNDRHPLTVYRANTLTPEQIQMAKEAGSLCP
KCGGGGYKGRVGVYEFMQNSEEIERLINTGATTDMIKEVAVQEGMLSILAYSLELVKEGHTTFEEVDRVTFTDSGLEAEL
KAKRKTGLVCDTCNAELQPDWLDCPYCMTPRFS

Sequences:

>Translated_673_residues
MTHSSLPKRTRALALRNDFSPFGNKLIQQGVVDHQQMEKALVETRRSGRPLTAIVEELTGKALSPELVRQYKKHHLFELK
ILYGLNSIDPEVQKIDIDQMGELINSLVPVELCRRHRLLPIRRVQDEVIVAMVEPDNLAAQDDLNRLFRLQNLTLRRIVI
TEDDYRQVLDGYLEQQVQIQIQQQEQAAKAAEAAELKKAVDIEDLDLGVAGELDEQEEESADLMNENQASSAPVIKLVNK
VLLKALQEGASDIHIEPQENDLRIRFRKDGVLQYAFDPLPKRIVPAVTARFKIMADLDIAERRVPQDGRIRRMFKGRKVD
FRVNSLPSRYGEKIVLRILDNSSTQLGLDLLITNQNILGQVREMAQRPFGLILVTGPTGSGKSTTLYSILAERNEPGINI
STAEDPIEYTLPGITQVQVIREKGMDFASILRAFLRQDPDVILVGETRDKETAKTAIEAALTGHLVLTTLHTNDAPGAIA
RLDEMGVEPFMISGSLLGVLAQRLMRRVCGECRIPYQPTVEELARYGLSSNDRHPLTVYRANTLTPEQIQMAKEAGSLCP
KCGGGGYKGRVGVYEFMQNSEEIERLINTGATTDMIKEVAVQEGMLSILAYSLELVKEGHTTFEEVDRVTFTDSGLEAEL
KAKRKTGLVCDTCNAELQPDWLDCPYCMTPRFS
>Mature_672_residues
THSSLPKRTRALALRNDFSPFGNKLIQQGVVDHQQMEKALVETRRSGRPLTAIVEELTGKALSPELVRQYKKHHLFELKI
LYGLNSIDPEVQKIDIDQMGELINSLVPVELCRRHRLLPIRRVQDEVIVAMVEPDNLAAQDDLNRLFRLQNLTLRRIVIT
EDDYRQVLDGYLEQQVQIQIQQQEQAAKAAEAAELKKAVDIEDLDLGVAGELDEQEEESADLMNENQASSAPVIKLVNKV
LLKALQEGASDIHIEPQENDLRIRFRKDGVLQYAFDPLPKRIVPAVTARFKIMADLDIAERRVPQDGRIRRMFKGRKVDF
RVNSLPSRYGEKIVLRILDNSSTQLGLDLLITNQNILGQVREMAQRPFGLILVTGPTGSGKSTTLYSILAERNEPGINIS
TAEDPIEYTLPGITQVQVIREKGMDFASILRAFLRQDPDVILVGETRDKETAKTAIEAALTGHLVLTTLHTNDAPGAIAR
LDEMGVEPFMISGSLLGVLAQRLMRRVCGECRIPYQPTVEELARYGLSSNDRHPLTVYRANTLTPEQIQMAKEAGSLCPK
CGGGGYKGRVGVYEFMQNSEEIERLINTGATTDMIKEVAVQEGMLSILAYSLELVKEGHTTFEEVDRVTFTDSGLEAELK
AKRKTGLVCDTCNAELQPDWLDCPYCMTPRFS

Specific function: Involved in the translocation of the type IV pilin [H]

COG id: COG2804

COG function: function code NU; Type II secretory pathway, ATPase PulE/Tfp pilus assembly pathway, ATPase PilB

Gene ontology:

Cell location: Cytoplasm (Potential) [H]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the GSP E family [H]

Homologues:

Organism=Escherichia coli, GI1789723, Length=429, Percent_Identity=45.6876456876457, Blast_Score=351, Evalue=7e-98,
Organism=Escherichia coli, GI1786296, Length=402, Percent_Identity=41.2935323383085, Blast_Score=286, Evalue=2e-78,
Organism=Escherichia coli, GI87082188, Length=201, Percent_Identity=42.2885572139304, Blast_Score=116, Evalue=6e-27,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR013374
- InterPro:   IPR007831
- InterPro:   IPR001482 [H]

Pfam domain/function: PF00437 GSPII_E; PF05157 GSPII_E_N [H]

EC number: NA

Molecular weight: Translated: 75431; Mature: 75300

Theoretical pI: Translated: 5.25; Mature: 5.25

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.3 %Cys     (Translated Protein)
2.5 %Met     (Translated Protein)
3.9 %Cys+Met (Translated Protein)
1.3 %Cys     (Mature Protein)
2.4 %Met     (Mature Protein)
3.7 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MTHSSLPKRTRALALRNDFSPFGNKLIQQGVVDHQQMEKALVETRRSGRPLTAIVEELTG
CCCCCCCHHHHHHHHHCCCCHHHHHHHHHHCCCHHHHHHHHHHHHHCCCCHHHHHHHHCC
KALSPELVRQYKKHHLFELKILYGLNSIDPEVQKIDIDQMGELINSLVPVELCRRHRLLP
CCCCHHHHHHHHHCCCEEEEEEECCCCCCCHHHEECHHHHHHHHHHCCHHHHHHHCCCCC
IRRVQDEVIVAMVEPDNLAAQDDLNRLFRLQNLTLRRIVITEDDYRQVLDGYLEQQVQIQ
HHHCCCEEEEEEECCCCCCHHHHHHHHHHHHCCEEEEEEECCHHHHHHHHHHHHHHHHHH
IQQQEQAAKAAEAAELKKAVDIEDLDLGVAGELDEQEEESADLMNENQASSAPVIKLVNK
HHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCHHHHHHHHHCCCCCCCCHHHHHHHH
VLLKALQEGASDIHIEPQENDLRIRFRKDGVLQYAFDPLPKRIVPAVTARFKIMADLDIA
HHHHHHHCCCCCEEECCCCCCEEEEEECCCEEEECCCCCCHHHHHHHHHHEEEEECCCHH
ERRVPQDGRIRRMFKGRKVDFRVNSLPSRYGEKIVLRILDNSSTQLGLDLLITNQNILGQ
HHCCCCCCHHHHHHCCCCEEEEECCCCHHHCCEEEEEEECCCCCCEEEEEEEECCHHHHH
VREMAQRPFGLILVTGPTGSGKSTTLYSILAERNEPGINISTAEDPIEYTLPGITQVQVI
HHHHHHCCCEEEEEECCCCCCCCHHHHHHHHHCCCCCCEEECCCCCCEEECCCCHHHHHH
REKGMDFASILRAFLRQDPDVILVGETRDKETAKTAIEAALTGHLVLTTLHTNDAPGAIA
HHHCCCHHHHHHHHHHCCCCEEEEECCCCHHHHHHHHHHHHHCEEEEEEEECCCCCHHHH
RLDEMGVEPFMISGSLLGVLAQRLMRRVCGECRIPYQPTVEELARYGLSSNDRHPLTVYR
HHHHCCCCCEEECCHHHHHHHHHHHHHHHHCCCCCCCCCHHHHHHCCCCCCCCCCEEEEE
ANTLTPEQIQMAKEAGSLCPKCGGGGYKGRVGVYEFMQNSEEIERLINTGATTDMIKEVA
CCCCCHHHHHHHHHHHCCCCCCCCCCCCCCHHHHHHHCCHHHHHHHHHCCCHHHHHHHHH
VQEGMLSILAYSLELVKEGHTTFEEVDRVTFTDSGLEAELKAKRKTGLVCDTCNAELQPD
HHHHHHHHHHHHHHHHHCCCCCHHHHCCEEECCCCCCHHHHHHHHCCCEEECCCCCCCCC
WLDCPYCMTPRFS
CCCCCCCCCCCCC
>Mature Secondary Structure 
THSSLPKRTRALALRNDFSPFGNKLIQQGVVDHQQMEKALVETRRSGRPLTAIVEELTG
CCCCCCHHHHHHHHHCCCCHHHHHHHHHHCCCHHHHHHHHHHHHHCCCCHHHHHHHHCC
KALSPELVRQYKKHHLFELKILYGLNSIDPEVQKIDIDQMGELINSLVPVELCRRHRLLP
CCCCHHHHHHHHHCCCEEEEEEECCCCCCCHHHEECHHHHHHHHHHCCHHHHHHHCCCCC
IRRVQDEVIVAMVEPDNLAAQDDLNRLFRLQNLTLRRIVITEDDYRQVLDGYLEQQVQIQ
HHHCCCEEEEEEECCCCCCHHHHHHHHHHHHCCEEEEEEECCHHHHHHHHHHHHHHHHHH
IQQQEQAAKAAEAAELKKAVDIEDLDLGVAGELDEQEEESADLMNENQASSAPVIKLVNK
HHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCHHHHHHHHHCCCCCCCCHHHHHHHH
VLLKALQEGASDIHIEPQENDLRIRFRKDGVLQYAFDPLPKRIVPAVTARFKIMADLDIA
HHHHHHHCCCCCEEECCCCCCEEEEEECCCEEEECCCCCCHHHHHHHHHHEEEEECCCHH
ERRVPQDGRIRRMFKGRKVDFRVNSLPSRYGEKIVLRILDNSSTQLGLDLLITNQNILGQ
HHCCCCCCHHHHHHCCCCEEEEECCCCHHHCCEEEEEEECCCCCCEEEEEEEECCHHHHH
VREMAQRPFGLILVTGPTGSGKSTTLYSILAERNEPGINISTAEDPIEYTLPGITQVQVI
HHHHHHCCCEEEEEECCCCCCCCHHHHHHHHHCCCCCCEEECCCCCCEEECCCCHHHHHH
REKGMDFASILRAFLRQDPDVILVGETRDKETAKTAIEAALTGHLVLTTLHTNDAPGAIA
HHHCCCHHHHHHHHHHCCCCEEEEECCCCHHHHHHHHHHHHHCEEEEEEEECCCCCHHHH
RLDEMGVEPFMISGSLLGVLAQRLMRRVCGECRIPYQPTVEELARYGLSSNDRHPLTVYR
HHHHCCCCCEEECCHHHHHHHHHHHHHHHHCCCCCCCCCHHHHHHCCCCCCCCCCEEEEE
ANTLTPEQIQMAKEAGSLCPKCGGGGYKGRVGVYEFMQNSEEIERLINTGATTDMIKEVA
CCCCCHHHHHHHHHHHCCCCCCCCCCCCCCHHHHHHHCCHHHHHHHHHCCCHHHHHHHHH
VQEGMLSILAYSLELVKEGHTTFEEVDRVTFTDSGLEAELKAKRKTGLVCDTCNAELQPD
HHHHHHHHHHHHHHHHHCCCCCHHHHCCEEECCCCCCHHHHHHHHCCCEEECCCCCCCCC
WLDCPYCMTPRFS
CCCCCCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 8820654 [H]