Definition Geobacter sulfurreducens PCA chromosome, complete genome.
Accession NC_002939
Length 3,814,139

Click here to switch to the map view.

The map label for this gene is epsE [H]

Identifier: 308513346

GI number: 308513346

Start: 3804900

End: 3805907

Strand: Reverse

Name: epsE [H]

Synonym: NA

Alternate gene names: 308513346

Gene position: 3805907-3804900 (Counterclockwise)

Preceding gene: 39998550

Following gene: 39998546

Centisome position: 99.78

GC content: 68.06

Gene sequence:

>1008_bases
GTGAGCGCACCCCGCGTGTCGATTCTCATGCCGGTCCGCAACGAAGAGCGCTTCCTGCCCGCTGCCCTGGCCTCCCTGTG
CCGGCAGTCCCTGACGGCATGGGAACTCATTGTCGTGGACGACGGCTCCACCGACGACACGCCGGAGCTGTTGCGCGTGG
CCGCGGCCCGAGACCGGCGGGTGAGGGTGTTCAACAACGCGGGCGCGGGACTGGTAGATGCCCTGAATTACGGCCTCGCC
CACTGCCGTGCGGAACTCGTGGCCCGCATGGACGGTGACGACATATCCCACCCGCAGAGGCTGGAACGCCAGGCCGCTGC
CCTTGACGCGGATCCCGGCCTGGGACTCGTGGCCACCCGGTTTCGCCACTTTCCCCGACACTCGGTGGGACTCGGCATGC
GTGCCTATGAAGAGTGGCAAAACGGCCTGCTGACTCACGAGGAAATCATGCGTGACCGCTTTGTGGAGTCGCCGGTCGTC
CACCCGAGTGTCATGGCTCGCCGGCAGGCTCTGACAGATGCCGGAGGCTACCGGAAGACCGGATGGGCAGAAGATTACGA
CCTCTGGCTGAGGCTTGCAGCCGGGGGGGTCAGGTTCACGCGGCTGCCGGAGGTGCTGTTCTTCTGGCGGGAGCGCCCCG
AGCGCGCGACCCGCACCATGGGGGAATATGCCGCCGATGCCTTCCGCGCCTGCAAGATCCATCACCTGTGTCAGGGGTTC
CTGCTGGGTGTGGACAACGTCACCCTGGCCGGGGCCGGGCTGGAGGGGAGGGCGTGGCAACGAGCCCTGGCGCGGGAGGG
GGTGCGGGTGGGCCGATGGCTCGACGTGGACCCGCGGAAACAGGGTCGAATCCTCCACGGGGCGCCGGTGACGGCACCGG
ATGACGTCAGGGCGGGCGCTGAAAAGATCCTCGTTACCGTGGGAACCCGGGGGGCGCGGGATGGAGTTCGGGCCTGGGCC
CGCAGGGCGGGCTTGCGTGAGGGAGAGGATTTCGTCTGCGTCACTTGA

Upstream 100 bases:
NA

Downstream 100 bases:
NA

Product: glycosyl transferase, group 2 family protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 335; Mature: 334

Protein sequence:
NA

Sequences:

>Translated_335_residues
MSAPRVSILMPVRNEERFLPAALASLCRQSLTAWELIVVDDGSTDDTPELLRVAAARDRRVRVFNNAGAGLVDALNYGLA
HCRAELVARMDGDDISHPQRLERQAAALDADPGLGLVATRFRHFPRHSVGLGMRAYEEWQNGLLTHEEIMRDRFVESPVV
HPSVMARRQALTDAGGYRKTGWAEDYDLWLRLAAGGVRFTRLPEVLFFWRERPERATRTMGEYAADAFRACKIHHLCQGF
LLGVDNVTLAGAGLEGRAWQRALAREGVRVGRWLDVDPRKQGRILHGAPVTAPDDVRAGAEKILVTVGTRGARDGVRAWA
RRAGLREGEDFVCVT
>Mature_334_residues
SAPRVSILMPVRNEERFLPAALASLCRQSLTAWELIVVDDGSTDDTPELLRVAAARDRRVRVFNNAGAGLVDALNYGLAH
CRAELVARMDGDDISHPQRLERQAAALDADPGLGLVATRFRHFPRHSVGLGMRAYEEWQNGLLTHEEIMRDRFVESPVVH
PSVMARRQALTDAGGYRKTGWAEDYDLWLRLAAGGVRFTRLPEVLFFWRERPERATRTMGEYAADAFRACKIHHLCQGFL
LGVDNVTLAGAGLEGRAWQRALAREGVRVGRWLDVDPRKQGRILHGAPVTAPDDVRAGAEKILVTVGTRGARDGVRAWAR
RAGLREGEDFVCVT

Specific function: May be involved in the production of the exopolysaccharide (EPS) component of the extracellular matrix during biofilm formation. EPS is responsible for the adhesion of chains of cells into bundles. Required for biofilm maintenance [H]

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the glycosyltransferase 2 family [H]

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR001173 [H]

Pfam domain/function: PF00535 Glycos_transf_2 [H]

EC number: 2.-.-.- [C]

Molecular weight: Translated: 37248; Mature: 37117

Theoretical pI: Translated: 8.75; Mature: 8.75

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.5 %Cys     (Translated Protein)
2.1 %Met     (Translated Protein)
3.6 %Cys+Met (Translated Protein)
1.5 %Cys     (Mature Protein)
1.8 %Met     (Mature Protein)
3.3 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSAPRVSILMPVRNEERFLPAALASLCRQSLTAWELIVVDDGSTDDTPELLRVAAARDRR
CCCCCEEEEEECCCCCCHHHHHHHHHHHHCCCEEEEEEEECCCCCCCHHHHHHHHHCCCE
VRVFNNAGAGLVDALNYGLAHCRAELVARMDGDDISHPQRLERQAAALDADPGLGLVATR
EEEECCCCCHHHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHCCCCCCCHHHHHH
FRHFPRHSVGLGMRAYEEWQNGLLTHEEIMRDRFVESPVVHPSVMARRQALTDAGGYRKT
HHHCCCHHHCCCHHHHHHHHCCCCCHHHHHHHHHHCCCCCCHHHHHHHHHHHCCCCCCCC
GWAEDYDLWLRLAAGGVRFTRLPEVLFFWRERPERATRTMGEYAADAFRACKIHHLCQGF
CCCCHHHHHHHHHCCCCCHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHH
LLGVDNVTLAGAGLEGRAWQRALAREGVRVGRWLDVDPRKQGRILHGAPVTAPDDVRAGA
HCCCCCEEEECCCCCCHHHHHHHHHCCCCCCCEECCCCCCCCCEEECCCCCCCHHHHCCC
EKILVTVGTRGARDGVRAWARRAGLREGEDFVCVT
CEEEEEECCCCCHHHHHHHHHHCCCCCCCCEEEEC
>Mature Secondary Structure 
SAPRVSILMPVRNEERFLPAALASLCRQSLTAWELIVVDDGSTDDTPELLRVAAARDRR
CCCCEEEEEECCCCCCHHHHHHHHHHHHCCCEEEEEEEECCCCCCCHHHHHHHHHCCCE
VRVFNNAGAGLVDALNYGLAHCRAELVARMDGDDISHPQRLERQAAALDADPGLGLVATR
EEEECCCCCHHHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHCCCCCCCHHHHHH
FRHFPRHSVGLGMRAYEEWQNGLLTHEEIMRDRFVESPVVHPSVMARRQALTDAGGYRKT
HHHCCCHHHCCCHHHHHHHHCCCCCHHHHHHHHHHCCCCCCHHHHHHHHHHHCCCCCCCC
GWAEDYDLWLRLAAGGVRFTRLPEVLFFWRERPERATRTMGEYAADAFRACKIHHLCQGF
CCCCHHHHHHHHHCCCCCHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHH
LLGVDNVTLAGAGLEGRAWQRALAREGVRVGRWLDVDPRKQGRILHGAPVTAPDDVRAGA
HCCCCCEEEECCCCCCHHHHHHHHHCCCCCCCEECCCCCCCCCEEECCCCCCCHHHHCCC
EKILVTVGTRGARDGVRAWARRAGLREGEDFVCVT
CEEEEEECCCCCHHHHHHHHHHCCCCCCCCEEEEC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: 8969506; 9384377 [H]