Definition Geobacter sulfurreducens PCA chromosome, complete genome.
Accession NC_002939
Length 3,814,139

Click here to switch to the map view.

The map label for this gene is 39998230

Identifier: 39998230

GI number: 39998230

Start: 3446890

End: 3448962

Strand: Reverse

Name: 39998230

Synonym: GSU3140

Alternate gene names: NA

Gene position: 3448962-3446890 (Counterclockwise)

Preceding gene: 39998231

Following gene: 39998229

Centisome position: 90.43

GC content: 66.43

Gene sequence:

>2073_bases
ATGAAACCTTACATCGCCCTTTCGGCCATTCTGGTCGCCATGCTCCTTGTCGCCTGTTCGGCACGGGGAGAAGTGCGCGT
CGTCCGGCAGGAGATTGCCGTGCGGCTCGTGCCGCCGCAGCATCTCGTCGTCGGTGAAAGCACCCTGTATCTCGCCCCCG
GTGCTGCCGGGGAGTTCAGCCTTGCCCTCAACGGCGCGGCCAGGCTCGAAGCCGTGCGCCTGGACGGCCGCGACATCCCT
TTCCGCAGGGAGGGGGGGACGCTCCGGCTGAATCTGTCCGCGGGCACCGGCGAGCGACGGGTGACGGTTGCCTACCGCTG
TATATTCAATGATCCGGCCCCGGAGCGGCCGGTCGTGACGGAGGACCCCTCTTACGGGGTGAACGCCGTGGTTGCCGAGC
GGGGGACTTATCTCGGCAGCGGCGCGGGCTGGTATCCGGAACCGGCGGCTCCGCCGGGCCGCCGCATCGTTACCGTCGAG
GCTCCCGCGGGCATCGAGGCCGTGACCGCCGGTCGGCGCGCTGTCAGGGAAACGGCCGGCGGCGTCACCACCTCGGTCTG
GGAGGAGGAACATCCCGCCGAGGCCCTGTCGCTGTCGGCGGGCTCCTACGTGGTTGCCGAGCGGAACGTGGACGGCATCC
CTCTCTACACCTACCTCTACCCTGAAAACGCGGTGCTCGCCGACCGCTATCTTGAGGCGTCCGCCGGCTACCTCCGGTTC
TACGCGGAGAAATTCGGCCCCTATCCCTTTGAGAAATTCGCCGTGGTGGAGAACTTCTTCCCCACCGGTTACGGTTTCCC
GTCCTACACCCTCATCGGCGGCACGGTCATCCGGCTTCCCTTCATCGTCCATACGAGCCTCCCCCATGAGATTGCTCACT
GCTGGTGGGGCAACGGCGTGCTGGTGGCCTACGAGAAGGGCAACTGGTCCGAGGGACTCGTCACCTACCTGGCGGACTAC
TTGCTGGAAGAGCGGAAGTCGGCCCGGGATGGGCGTGACTACCGCTACCGCCTCCTGGCCGACTATGCCTCGCTGGTGTC
CCCAGGAGAGGATTTCCCGCTACGGCGGTTCATGGGACGGGTCGATCCGGCCTCCCGCACCATCGGCTACGGCAAGGGAT
CCATGCTGTTTCACATGGTCCGCCGGGAAATTGGTGACGATGCCTTTTTCGGCGCCCTCAGGCAGGTTTTTCGTGAGTTC
CGGTTCAAGGCGGCATCCTGGGACGATTTCGCCCTGGCCTTTTCCCGCGCCTCTGGCCGCGACATGGTTTCGTTCATGAA
CCCGTGGCTTGAACGGACCGGCGGTCCCCGACTCGCCCTGACCGATGTGGAGCGGCGGCAGGGCGGGGATGGCTGGCTCG
TGAGCGGGGTGGTCCGGCAGGTGGGTGATGCGTTTCCTGGGCGGGTGCGGGTGCGGGTGGACGCCGGCGGCACGTCCCGG
GACATTCTGGTGGAGCCAACGAGGGGGCGAACTGCCTTTACGGTCGATGTGAGCGGGCCGCCCGAGCGGGTTACGCTCGA
TCCCGAGGCGGATACCTTTCGACTTCTATCACCGGAGGAACTCCCGGCAACGGTGAACAGGATCAAGGGGAGCATGGCCC
TGACGGTCGTGACGTCGCCCGGCTGCGGTGCTGACAGGGATACTCTGGCGCTTCTTCTCCGCTCTCTCGGCCAGGCGGAG
GCTCCGCTGATCCGGCAGGACCAGCTCAATGCCGCGGCCCTGGCCGGTCGCGACATTCTTTTTTGCGGCGTTCCCGGGAC
GACTGGTATCCGGTCGCCGCTGCCCCACGGCGTTTCAGCGTCTGCCGGCACCTTTGTCGTGGACGGCACGACATATGCCG
GAGCCGGCGACATGCTCTTCGCGGTCGCCAACCGGCCCGACGCGCCGGGCCGGGTAACGGCGTTCCTTCATTCCCTCTCC
CCGGCTGCCGCCGGTGCGGCAGCCCTCAAGATCACCCATTACGGGCGCTACGGGGTGCTCGTTTTTTCGGGCGGGGACAA
CCGGGTGAAGGAAACTCCCCCGGCGCTCAGCGAAACCAGCGTGGTAACGTTTGACCGGCAGGTTGACAGATAG

Upstream 100 bases:

>100_bases
GGGAGGAATGTCTCCCCGCCCCGCGGTTCCGGTCATGCGGCGGGGCGGGCTTCCGGGGCAGCCCTTGGTATCGGCCGGTT
TGATGGTATAGTTGTTGACC

Downstream 100 bases:

>100_bases
GATGACGCGACGTCATTCGGGAGGAAGCATGAAGCGATTGGGAACATTCGCCGGCATTGCGCTGGTGCTGGCCCTCACTG
CGGTGGTGGCACGTACCTGC

Product: peptidase, M1 family protein

Products: NA

Alternate protein names: Metallopeptidase; Aminopeptidase; Peptidase M; Epsilon-Poly-L-Lysine-Degrading; Aminopeptidase N; Peptidase; Peptidase Family M1 Protein; Aminopeptidase N-Like Protein; M1 Family Peptidase; Secreted Aminopeptidase; Peptidase M1 Family Protein; Peptidase M1 Membrane Alanine Aminopeptidase-Like Protein; Aminopepetidase; Exported Aminopeptidase; Protease; Peptidase M1 Superfamily Peptidase; M1 Family Metalloprotease; PDZ Domain-Containing Protein

Number of amino acids: Translated: 690; Mature: 690

Protein sequence:

>690_residues
MKPYIALSAILVAMLLVACSARGEVRVVRQEIAVRLVPPQHLVVGESTLYLAPGAAGEFSLALNGAARLEAVRLDGRDIP
FRREGGTLRLNLSAGTGERRVTVAYRCIFNDPAPERPVVTEDPSYGVNAVVAERGTYLGSGAGWYPEPAAPPGRRIVTVE
APAGIEAVTAGRRAVRETAGGVTTSVWEEEHPAEALSLSAGSYVVAERNVDGIPLYTYLYPENAVLADRYLEASAGYLRF
YAEKFGPYPFEKFAVVENFFPTGYGFPSYTLIGGTVIRLPFIVHTSLPHEIAHCWWGNGVLVAYEKGNWSEGLVTYLADY
LLEERKSARDGRDYRYRLLADYASLVSPGEDFPLRRFMGRVDPASRTIGYGKGSMLFHMVRREIGDDAFFGALRQVFREF
RFKAASWDDFALAFSRASGRDMVSFMNPWLERTGGPRLALTDVERRQGGDGWLVSGVVRQVGDAFPGRVRVRVDAGGTSR
DILVEPTRGRTAFTVDVSGPPERVTLDPEADTFRLLSPEELPATVNRIKGSMALTVVTSPGCGADRDTLALLLRSLGQAE
APLIRQDQLNAAALAGRDILFCGVPGTTGIRSPLPHGVSASAGTFVVDGTTYAGAGDMLFAVANRPDAPGRVTAFLHSLS
PAAAGAAALKITHYGRYGVLVFSGGDNRVKETPPALSETSVVTFDRQVDR

Sequences:

>Translated_690_residues
MKPYIALSAILVAMLLVACSARGEVRVVRQEIAVRLVPPQHLVVGESTLYLAPGAAGEFSLALNGAARLEAVRLDGRDIP
FRREGGTLRLNLSAGTGERRVTVAYRCIFNDPAPERPVVTEDPSYGVNAVVAERGTYLGSGAGWYPEPAAPPGRRIVTVE
APAGIEAVTAGRRAVRETAGGVTTSVWEEEHPAEALSLSAGSYVVAERNVDGIPLYTYLYPENAVLADRYLEASAGYLRF
YAEKFGPYPFEKFAVVENFFPTGYGFPSYTLIGGTVIRLPFIVHTSLPHEIAHCWWGNGVLVAYEKGNWSEGLVTYLADY
LLEERKSARDGRDYRYRLLADYASLVSPGEDFPLRRFMGRVDPASRTIGYGKGSMLFHMVRREIGDDAFFGALRQVFREF
RFKAASWDDFALAFSRASGRDMVSFMNPWLERTGGPRLALTDVERRQGGDGWLVSGVVRQVGDAFPGRVRVRVDAGGTSR
DILVEPTRGRTAFTVDVSGPPERVTLDPEADTFRLLSPEELPATVNRIKGSMALTVVTSPGCGADRDTLALLLRSLGQAE
APLIRQDQLNAAALAGRDILFCGVPGTTGIRSPLPHGVSASAGTFVVDGTTYAGAGDMLFAVANRPDAPGRVTAFLHSLS
PAAAGAAALKITHYGRYGVLVFSGGDNRVKETPPALSETSVVTFDRQVDR
>Mature_690_residues
MKPYIALSAILVAMLLVACSARGEVRVVRQEIAVRLVPPQHLVVGESTLYLAPGAAGEFSLALNGAARLEAVRLDGRDIP
FRREGGTLRLNLSAGTGERRVTVAYRCIFNDPAPERPVVTEDPSYGVNAVVAERGTYLGSGAGWYPEPAAPPGRRIVTVE
APAGIEAVTAGRRAVRETAGGVTTSVWEEEHPAEALSLSAGSYVVAERNVDGIPLYTYLYPENAVLADRYLEASAGYLRF
YAEKFGPYPFEKFAVVENFFPTGYGFPSYTLIGGTVIRLPFIVHTSLPHEIAHCWWGNGVLVAYEKGNWSEGLVTYLADY
LLEERKSARDGRDYRYRLLADYASLVSPGEDFPLRRFMGRVDPASRTIGYGKGSMLFHMVRREIGDDAFFGALRQVFREF
RFKAASWDDFALAFSRASGRDMVSFMNPWLERTGGPRLALTDVERRQGGDGWLVSGVVRQVGDAFPGRVRVRVDAGGTSR
DILVEPTRGRTAFTVDVSGPPERVTLDPEADTFRLLSPEELPATVNRIKGSMALTVVTSPGCGADRDTLALLLRSLGQAE
APLIRQDQLNAAALAGRDILFCGVPGTTGIRSPLPHGVSASAGTFVVDGTTYAGAGDMLFAVANRPDAPGRVTAFLHSLS
PAAAGAAALKITHYGRYGVLVFSGGDNRVKETPPALSETSVVTFDRQVDR

Specific function: Unknown

COG id: COG0308

COG function: function code E; Aminopeptidase N

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

Organism=Saccharomyces cerevisiae, GI9755335, Length=248, Percent_Identity=26.2096774193548, Blast_Score=84, Evalue=5e-17,
Organism=Saccharomyces cerevisiae, GI6321837, Length=257, Percent_Identity=25.6809338521401, Blast_Score=82, Evalue=2e-16,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 74603; Mature: 74603

Theoretical pI: Translated: 7.01; Mature: 7.01

Prosite motif: PS00013 PROKAR_LIPOPROTEIN ; PS00142 ZINC_PROTEASE

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.7 %Cys     (Translated Protein)
1.3 %Met     (Translated Protein)
2.0 %Cys+Met (Translated Protein)
0.7 %Cys     (Mature Protein)
1.3 %Met     (Mature Protein)
2.0 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKPYIALSAILVAMLLVACSARGEVRVVRQEIAVRLVPPQHLVVGESTLYLAPGAAGEFS
CCCHHHHHHHHHHHHHHHHCCCCCEEEEEEEEEEEECCCCEEEECCCEEEECCCCCCCEE
LALNGAARLEAVRLDGRDIPFRREGGTLRLNLSAGTGERRVTVAYRCIFNDPAPERPVVT
EEECCCCEEEEEEECCCCCCEEECCCEEEEEEECCCCCEEEEEEEEEEECCCCCCCCEEE
EDPSYGVNAVVAERGTYLGSGAGWYPEPAAPPGRRIVTVEAPAGIEAVTAGRRAVRETAG
CCCCCCCEEEEEECCCEECCCCCCCCCCCCCCCCEEEEEECCCCCHHHHHHHHHHHHHCC
GVTTSVWEEEHPAEALSLSAGSYVVAERNVDGIPLYTYLYPENAVLADRYLEASAGYLRF
CCEEEHHCCCCCCHHEEECCCCEEEEECCCCCCEEEEEECCCCCCHHHHHHHCCCHHHHH
YAEKFGPYPFEKFAVVENFFPTGYGFPSYTLIGGTVIRLPFIVHTSLPHEIAHCWWGNGV
HHHHHCCCCHHHHHHHHHCCCCCCCCCCEEEECCEEEEEEEEEECCCCHHHHHEECCCCE
LVAYEKGNWSEGLVTYLADYLLEERKSARDGRDYRYRLLADYASLVSPGEDFPLRRFMGR
EEEEECCCCCHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHCCCCCCCCHHHHHCC
VDPASRTIGYGKGSMLFHMVRREIGDDAFFGALRQVFREFRFKAASWDDFALAFSRASGR
CCCCHHEECCCCHHHHHHHHHHHHCCHHHHHHHHHHHHHHCCCCCCCCCCEEEEECCCCC
DMVSFMNPWLERTGGPRLALTDVERRQGGDGWLVSGVVRQVGDAFPGRVRVRVDAGGTSR
HHHHHHHHHHHHCCCCEEEEEEHHHHCCCCCCHHHHHHHHHCCCCCCEEEEEEECCCCCC
DILVEPTRGRTAFTVDVSGPPERVTLDPEADTFRLLSPEELPATVNRIKGSMALTVVTSP
CEEEECCCCCEEEEEECCCCCCEEEECCCCCEEEECCCHHHHHHHHHCCCCEEEEEEECC
GCGADRDTLALLLRSLGQAEAPLIRQDQLNAAALAGRDILFCGVPGTTGIRSPLPHGVSA
CCCCCHHHHHHHHHHCCCCCCCCEECCCCCHHHCCCCEEEEEECCCCCCCCCCCCCCCCC
SAGTFVVDGTTYAGAGDMLFAVANRPDAPGRVTAFLHSLSPAAAGAAALKITHYGRYGVL
CCCEEEECCCEECCCCCEEEEECCCCCCCCHHHHHHHHCCCHHCCCEEEEEEECCCEEEE
VFSGGDNRVKETPPALSETSVVTFDRQVDR
EEECCCCCCCCCCCCCCCCEEEEECCCCCC
>Mature Secondary Structure
MKPYIALSAILVAMLLVACSARGEVRVVRQEIAVRLVPPQHLVVGESTLYLAPGAAGEFS
CCCHHHHHHHHHHHHHHHHCCCCCEEEEEEEEEEEECCCCEEEECCCEEEECCCCCCCEE
LALNGAARLEAVRLDGRDIPFRREGGTLRLNLSAGTGERRVTVAYRCIFNDPAPERPVVT
EEECCCCEEEEEEECCCCCCEEECCCEEEEEEECCCCCEEEEEEEEEEECCCCCCCCEEE
EDPSYGVNAVVAERGTYLGSGAGWYPEPAAPPGRRIVTVEAPAGIEAVTAGRRAVRETAG
CCCCCCCEEEEEECCCEECCCCCCCCCCCCCCCCEEEEEECCCCCHHHHHHHHHHHHHCC
GVTTSVWEEEHPAEALSLSAGSYVVAERNVDGIPLYTYLYPENAVLADRYLEASAGYLRF
CCEEEHHCCCCCCHHEEECCCCEEEEECCCCCCEEEEEECCCCCCHHHHHHHCCCHHHHH
YAEKFGPYPFEKFAVVENFFPTGYGFPSYTLIGGTVIRLPFIVHTSLPHEIAHCWWGNGV
HHHHHCCCCHHHHHHHHHCCCCCCCCCCEEEECCEEEEEEEEEECCCCHHHHHEECCCCE
LVAYEKGNWSEGLVTYLADYLLEERKSARDGRDYRYRLLADYASLVSPGEDFPLRRFMGR
EEEEECCCCCHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHCCCCCCCCHHHHHCC
VDPASRTIGYGKGSMLFHMVRREIGDDAFFGALRQVFREFRFKAASWDDFALAFSRASGR
CCCCHHEECCCCHHHHHHHHHHHHCCHHHHHHHHHHHHHHCCCCCCCCCCEEEEECCCCC
DMVSFMNPWLERTGGPRLALTDVERRQGGDGWLVSGVVRQVGDAFPGRVRVRVDAGGTSR
HHHHHHHHHHHHCCCCEEEEEEHHHHCCCCCCHHHHHHHHHCCCCCCEEEEEEECCCCCC
DILVEPTRGRTAFTVDVSGPPERVTLDPEADTFRLLSPEELPATVNRIKGSMALTVVTSP
CEEEECCCCCEEEEEECCCCCCEEEECCCCCEEEECCCHHHHHHHHHCCCCEEEEEEECC
GCGADRDTLALLLRSLGQAEAPLIRQDQLNAAALAGRDILFCGVPGTTGIRSPLPHGVSA
CCCCCHHHHHHHHHHCCCCCCCCEECCCCCHHHCCCCEEEEEECCCCCCCCCCCCCCCCC
SAGTFVVDGTTYAGAGDMLFAVANRPDAPGRVTAFLHSLSPAAAGAAALKITHYGRYGVL
CCCEEEECCCEECCCCCEEEEECCCCCCCCHHHHHHHHCCCHHCCCEEEEEEECCCEEEE
VFSGGDNRVKETPPALSETSVVTFDRQVDR
EEECCCCCCCCCCCCCCCCEEEEECCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA