Definition Geobacter metallireducens GS-15 chromosome, complete genome.
Accession NC_007517
Length 3,997,420

Click here to switch to the map view.

The map label for this gene is gspD [H]

Identifier: 78224554

GI number: 78224554

Start: 3779990

End: 3781900

Strand: Direct

Name: gspD [H]

Synonym: Gmet_3364

Alternate gene names: 78224554

Gene position: 3779990-3781900 (Clockwise)

Preceding gene: 78224553

Following gene: 78224555

Centisome position: 94.56

GC content: 60.81

Gene sequence:

>1911_bases
GTGATCATACGCTTCTCAGCAGGGCTCGCCTCGGCGGCACTTCTCCTCTCTCTCCTGGCCCCCGTGCCAGCCATGGCCAA
GGGGGTGGTTCTCAACTTCAGCGATGTGGATATCGCCACCATGGTGAAGTTCATCAGCGACCTCACCGGTAAGAACTTCG
TCATGGACGAACGGGTGAAGGGGAAGATCTCGGTCTATTCCCCTTCGAAGCTCTCGTCCGACGAAGCCTTCAACGTCTTC
ACATCAGTGCTGGAACTGAAGGGATTCACCATCGTACCGGCAGGAAGGGTCTACAAGATCATCCCGACGTCCCAGGCGAA
GCAGTCGGGGATGAAGCTCCTCACGGAGAAGGACCGGGGACCGGTCAGCGACGCCTACGTGGCCCGAATTATTCCCCTCG
AAAGAATCTCGGCCCAGGAGGCGGTGACCTTTCTCCAGCCCATCGTTTCCAAGGATGGCTACATCGCCGCCTTCGGCGCC
AACAACATGCTCATGGTGGTGGATTCGGCCCTGAACATCCAGAAGCTGACCGGCATCCTCGCCCAGGTTGATTCGCTCCA
GAAGCGCGAGGGAACCGAAACCGTCTTCCTCAAGAACGCCTCGGCGGAAAGCGTGGCAACGGTGATCCGCGAATGGCTCG
GCGGCAAGGGGAGCCGGCCGGCCGCCGCTGGTCAGGGCGGGCAACAGACCACCTCCGCCGCCGGCGTGCTCGTCATTCCC
GACAACCGACTCAACGCCCTCGTCATCTCCGGCAACGACCGCGACAAGGAAGACATCAAGAAGCTGGTCGCCCTGATAGA
CGTCGTTCCCCCCACTTCGAGCAGCAAGATCAACGTCTACTACCTGGAGAATGCCGATGCCACCGAGGTGGGTAAAGTCC
TCGACGGCATCATCAAAGGTGTCCCTCTCCCGGGCCAGCAGGGGGGAGCGCCCGCAACGGCCCCTGCCCAATCCCCCTTC
GAGGGGGGCAAGATTTCCGTCACCCCCGACAAGGCCACCAACTCCCTGGTGATCATGGCCTCGCCGGTCGACTACCAGAA
CCTCCTCCAGGTGATCCAGAAACTGGACAAGCGACGCCGCCAGGTATTCGTACAGGCGGTCATTGCCGAAGTCTCCCTCG
ACAAGGCGAAAGAACTGGGCCTCCAGTTGGCCGTGAGCGGCGGAGGGACAGCCGGCAACACGGCTGAGGCAGGGGTCTTC
GATCCCTTCAACTTCGTGGGGGGGGCTTCTCCGCAACAGGCAGCAATCCTCAACGTACTCACCGGATTTGCCGGCTCAAG
CAACCTGCAACTGGGAGGGGTCCTCAAGGCTCTCATCTCCAACGGCGCCGTGAACGTCCTCTCCACACCCAACATTCTGA
CCTCCGACAACAAGGAAGCCGAGATCTTCGTGGGCGAGAACGTGCCGTTTCTCACCCAGACAAACCTCACATCCACGGGC
CTTTCCCAGCAGTCCATCGAGCGGAAGGACACCGGCATCACGCTCCGGATCACCCCCCAGATCAGCGAGGGGGAATTCGT
GAAGCTCGACATCTACCAGGAGATCTCGGCCGTCAAGGATAGCGTCGGCCAGGCCAAGGACCTGGTCACCACCAAGCGCT
CGGCCAAGACCGCCGTGGTGGTGAAGGACAAGGACACCGTGGTCATCGGCGGGCTCATCCAGGACCGCGACACCGAAACA
ATCAACAAGATCCCGATCCTCGGCGACATCCCGCTCCTGGGGTGGTTTTTCAAGACCAAATCGGCCCGGCGGGAAAAGAC
CAATCTGATGATCGTCCTCACCCCGCGGATTATCCGCGGTGCCCAGGAAATGGCTGAGGTGTCGAACCTTCAGAAGGGAA
CGTTCGACAACGCGGTGAGGATGGATATCCCCTTCAGCCTCGACCGGGAAGAACTGAAGACGAAGCAATGA

Upstream 100 bases:

>100_bases
ATCTGGTACGGGACGGGCAACCGTCAACGTTCAGTTACGACATACGCTAATCCAGGTCCGGGCCATCCCGAACCAGCAGA
CGCTTCACCCGGAGGCATTC

Downstream 100 bases:

>100_bases
CCGATACCCACGACGTGGAACGCATAGCCGAAAGGCTCGGTATCCCTTTCACGGCCGAAATCGAGGAAGGTGAAGCCGAC
TTGACGCTCCTGGCCCGGCT

Product: type II and III secretion system protein:NolW-like

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 636; Mature: 636

Protein sequence:

>636_residues
MIIRFSAGLASAALLLSLLAPVPAMAKGVVLNFSDVDIATMVKFISDLTGKNFVMDERVKGKISVYSPSKLSSDEAFNVF
TSVLELKGFTIVPAGRVYKIIPTSQAKQSGMKLLTEKDRGPVSDAYVARIIPLERISAQEAVTFLQPIVSKDGYIAAFGA
NNMLMVVDSALNIQKLTGILAQVDSLQKREGTETVFLKNASAESVATVIREWLGGKGSRPAAAGQGGQQTTSAAGVLVIP
DNRLNALVISGNDRDKEDIKKLVALIDVVPPTSSSKINVYYLENADATEVGKVLDGIIKGVPLPGQQGGAPATAPAQSPF
EGGKISVTPDKATNSLVIMASPVDYQNLLQVIQKLDKRRRQVFVQAVIAEVSLDKAKELGLQLAVSGGGTAGNTAEAGVF
DPFNFVGGASPQQAAILNVLTGFAGSSNLQLGGVLKALISNGAVNVLSTPNILTSDNKEAEIFVGENVPFLTQTNLTSTG
LSQQSIERKDTGITLRITPQISEGEFVKLDIYQEISAVKDSVGQAKDLVTTKRSAKTAVVVKDKDTVVIGGLIQDRDTET
INKIPILGDIPLLGWFFKTKSARREKTNLMIVLTPRIIRGAQEMAEVSNLQKGTFDNAVRMDIPFSLDREELKTKQ

Sequences:

>Translated_636_residues
MIIRFSAGLASAALLLSLLAPVPAMAKGVVLNFSDVDIATMVKFISDLTGKNFVMDERVKGKISVYSPSKLSSDEAFNVF
TSVLELKGFTIVPAGRVYKIIPTSQAKQSGMKLLTEKDRGPVSDAYVARIIPLERISAQEAVTFLQPIVSKDGYIAAFGA
NNMLMVVDSALNIQKLTGILAQVDSLQKREGTETVFLKNASAESVATVIREWLGGKGSRPAAAGQGGQQTTSAAGVLVIP
DNRLNALVISGNDRDKEDIKKLVALIDVVPPTSSSKINVYYLENADATEVGKVLDGIIKGVPLPGQQGGAPATAPAQSPF
EGGKISVTPDKATNSLVIMASPVDYQNLLQVIQKLDKRRRQVFVQAVIAEVSLDKAKELGLQLAVSGGGTAGNTAEAGVF
DPFNFVGGASPQQAAILNVLTGFAGSSNLQLGGVLKALISNGAVNVLSTPNILTSDNKEAEIFVGENVPFLTQTNLTSTG
LSQQSIERKDTGITLRITPQISEGEFVKLDIYQEISAVKDSVGQAKDLVTTKRSAKTAVVVKDKDTVVIGGLIQDRDTET
INKIPILGDIPLLGWFFKTKSARREKTNLMIVLTPRIIRGAQEMAEVSNLQKGTFDNAVRMDIPFSLDREELKTKQ
>Mature_636_residues
MIIRFSAGLASAALLLSLLAPVPAMAKGVVLNFSDVDIATMVKFISDLTGKNFVMDERVKGKISVYSPSKLSSDEAFNVF
TSVLELKGFTIVPAGRVYKIIPTSQAKQSGMKLLTEKDRGPVSDAYVARIIPLERISAQEAVTFLQPIVSKDGYIAAFGA
NNMLMVVDSALNIQKLTGILAQVDSLQKREGTETVFLKNASAESVATVIREWLGGKGSRPAAAGQGGQQTTSAAGVLVIP
DNRLNALVISGNDRDKEDIKKLVALIDVVPPTSSSKINVYYLENADATEVGKVLDGIIKGVPLPGQQGGAPATAPAQSPF
EGGKISVTPDKATNSLVIMASPVDYQNLLQVIQKLDKRRRQVFVQAVIAEVSLDKAKELGLQLAVSGGGTAGNTAEAGVF
DPFNFVGGASPQQAAILNVLTGFAGSSNLQLGGVLKALISNGAVNVLSTPNILTSDNKEAEIFVGENVPFLTQTNLTSTG
LSQQSIERKDTGITLRITPQISEGEFVKLDIYQEISAVKDSVGQAKDLVTTKRSAKTAVVVKDKDTVVIGGLIQDRDTET
INKIPILGDIPLLGWFFKTKSARREKTNLMIVLTPRIIRGAQEMAEVSNLQKGTFDNAVRMDIPFSLDREELKTKQ

Specific function: Involved in a general secretion pathway (GSP) for the export of proteins [H]

COG id: COG1450

COG function: function code NU; Type II secretory pathway, component PulD

Gene ontology:

Cell location: Cell outer membrane (Probable) [H]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the GSP D family [H]

Homologues:

Organism=Escherichia coli, GI87082242, Length=608, Percent_Identity=32.8947368421053, Blast_Score=266, Evalue=3e-72,
Organism=Escherichia coli, GI1789793, Length=299, Percent_Identity=25.752508361204, Blast_Score=79, Evalue=8e-16,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR001775
- InterPro:   IPR005644
- InterPro:   IPR004846
- InterPro:   IPR013356
- InterPro:   IPR004845 [H]

Pfam domain/function: PF00263 Secretin; PF03958 Secretin_N [H]

EC number: NA

Molecular weight: Translated: 67782; Mature: 67782

Theoretical pI: Translated: 9.41; Mature: 9.41

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.0 %Cys     (Translated Protein)
1.7 %Met     (Translated Protein)
1.7 %Cys+Met (Translated Protein)
0.0 %Cys     (Mature Protein)
1.7 %Met     (Mature Protein)
1.7 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MIIRFSAGLASAALLLSLLAPVPAMAKGVVLNFSDVDIATMVKFISDLTGKNFVMDERVK
CEEEECCCHHHHHHHHHHHCCCCHHHCCEEEEECCCCHHHHHHHHHHCCCCCEEECCCCC
GKISVYSPSKLSSDEAFNVFTSVLELKGFTIVPAGRVYKIIPTSQAKQSGMKLLTEKDRG
CEEEEECCCCCCCCHHHHHHHHHHHHCCCEEECCCCEEEEECCCHHHHHCHHHHHCCCCC
PVSDAYVARIIPLERISAQEAVTFLQPIVSKDGYIAAFGANNMLMVVDSALNIQKLTGIL
CCCHHHHHHCCCHHHHHHHHHHHHHHHHHCCCCEEEEECCCCEEEEEECCCCHHHHHHHH
AQVDSLQKREGTETVFLKNASAESVATVIREWLGGKGSRPAAAGQGGQQTTSAAGVLVIP
HHHHHHHHCCCCCEEEEECCCHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCEEEEEC
DNRLNALVISGNDRDKEDIKKLVALIDVVPPTSSSKINVYYLENADATEVGKVLDGIIKG
CCCCCEEEEECCCCCHHHHHHHHHHHHCCCCCCCCEEEEEEECCCCHHHHHHHHHHHHHC
VPLPGQQGGAPATAPAQSPFEGGKISVTPDKATNSLVIMASPVDYQNLLQVIQKLDKRRR
CCCCCCCCCCCCCCCCCCCCCCCEEEECCCCCCCEEEEEECCCCHHHHHHHHHHHHHHHH
QVFVQAVIAEVSLDKAKELGLQLAVSGGGTAGNTAEAGVFDPFNFVGGASPQQAAILNVL
HHHHHHHHHHHHHHHHHHCCEEEEEECCCCCCCCCCCCCCCCHHHCCCCCCHHHHHHHHH
TGFAGSSNLQLGGVLKALISNGAVNVLSTPNILTSDNKEAEIFVGENVPFLTQTNLTSTG
HCCCCCCCCCHHHHHHHHHCCCCEEEEECCCEEECCCCCEEEEECCCCCEEEECCCCCCC
LSQQSIERKDTGITLRITPQISEGEFVKLDIYQEISAVKDSVGQAKDLVTTKRSAKTAVV
CCHHHHHHHHCCEEEEEECCCCCCCEEEEEHHHHHHHHHHHHHHHHHHHHHCCCCCEEEE
VKDKDTVVIGGLIQDRDTETINKIPILGDIPLLGWFFKTKSARREKTNLMIVLTPRIIRG
EECCCEEEEEEEECCCCCCHHHCCCCEECCCHHHHHHHCCCCCHHHCCEEEEECCHHHHH
AQEMAEVSNLQKGTFDNAVRMDIPFSLDREELKTKQ
HHHHHHHHHCCCCCCCCEEEEECCCCCCHHHHCCCC
>Mature Secondary Structure
MIIRFSAGLASAALLLSLLAPVPAMAKGVVLNFSDVDIATMVKFISDLTGKNFVMDERVK
CEEEECCCHHHHHHHHHHHCCCCHHHCCEEEEECCCCHHHHHHHHHHCCCCCEEECCCCC
GKISVYSPSKLSSDEAFNVFTSVLELKGFTIVPAGRVYKIIPTSQAKQSGMKLLTEKDRG
CEEEEECCCCCCCCHHHHHHHHHHHHCCCEEECCCCEEEEECCCHHHHHCHHHHHCCCCC
PVSDAYVARIIPLERISAQEAVTFLQPIVSKDGYIAAFGANNMLMVVDSALNIQKLTGIL
CCCHHHHHHCCCHHHHHHHHHHHHHHHHHCCCCEEEEECCCCEEEEEECCCCHHHHHHHH
AQVDSLQKREGTETVFLKNASAESVATVIREWLGGKGSRPAAAGQGGQQTTSAAGVLVIP
HHHHHHHHCCCCCEEEEECCCHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCEEEEEC
DNRLNALVISGNDRDKEDIKKLVALIDVVPPTSSSKINVYYLENADATEVGKVLDGIIKG
CCCCCEEEEECCCCCHHHHHHHHHHHHCCCCCCCCEEEEEEECCCCHHHHHHHHHHHHHC
VPLPGQQGGAPATAPAQSPFEGGKISVTPDKATNSLVIMASPVDYQNLLQVIQKLDKRRR
CCCCCCCCCCCCCCCCCCCCCCCEEEECCCCCCCEEEEEECCCCHHHHHHHHHHHHHHHH
QVFVQAVIAEVSLDKAKELGLQLAVSGGGTAGNTAEAGVFDPFNFVGGASPQQAAILNVL
HHHHHHHHHHHHHHHHHHCCEEEEEECCCCCCCCCCCCCCCCHHHCCCCCCHHHHHHHHH
TGFAGSSNLQLGGVLKALISNGAVNVLSTPNILTSDNKEAEIFVGENVPFLTQTNLTSTG
HCCCCCCCCCHHHHHHHHHCCCCEEEEECCCEEECCCCCEEEEECCCCCEEEECCCCCCC
LSQQSIERKDTGITLRITPQISEGEFVKLDIYQEISAVKDSVGQAKDLVTTKRSAKTAVV
CCHHHHHHHHCCEEEEEECCCCCCCEEEEEHHHHHHHHHHHHHHHHHHHHHCCCCCEEEE
VKDKDTVVIGGLIQDRDTETINKIPILGDIPLLGWFFKTKSARREKTNLMIVLTPRIIRG
EECCCEEEEEEEECCCCCCHHHCCCCEECCCHHHHHHHCCCCCHHHCCEEEEECCHHHHH
AQEMAEVSNLQKGTFDNAVRMDIPFSLDREELKTKQ
HHHHHHHHHCCCCCCCCEEEEECCCCCCHHHHCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 9278503 [H]