Definition Prochlorococcus marinus str. MIT 9313 chromosome, complete genome.
Accession NC_005071
Length 2,410,873

Click here to switch to the map view.

The map label for this gene is epsD [H]

Identifier: 33862482

GI number: 33862482

Start: 239513

End: 240691

Strand: Reverse

Name: epsD [H]

Synonym: PMT0209

Alternate gene names: 33862482

Gene position: 240691-239513 (Counterclockwise)

Preceding gene: 33862483

Following gene: 33862473

Centisome position: 9.98

GC content: 56.66

Gene sequence:

>1179_bases
GTGGCTCACATTGCCTGGCTAGGCAAAAAAACACCGTTCTGCGGCAACGTCACCTACGGTCTCAATACGACTGAGGCCCT
AAGACAACGCGGCCATCAGACCAGTTTTATTCACTTCGACACTCCAGGCGGCCTTAGCAACGGCGAGAGCGCACTGTTGG
CCAATGACCCAGAAGTGAGCCTTCCATACCTAGTGAAGTCACAGGTTTACACCATTCCCTTCCCTGGAGCGCAGCGAGAA
CTCAGAGAATCATTAGAAAGGCTGCAACCCGATCTCGTCCACGCCAGCCTCACCCTTTCCCCCCTCGACTTCCGGCTGCC
AGAACTCTGCGAGCAAATCGGTGTGCCATTAGTGGCAACTTTCCACCCACCATTTGATAGCGGCATGCGCCACCTCACGG
CTGGCACACAACAGCTCACGTATCAGCTCTACGCCCCTGCCCTGGCTCGCTATGACAAGGTAATCGTCTTCTCCGAGCTG
CAAGCTGAGGTTCTTACCAAACTTGGAGTACAGGAACAACGACTCGCCGTGATCCCCAACGGAGTCGATCCTGAATGTTG
GGCACCAACAAGTCCCCAATGCAGCAACCCAATGCAGCAAGAGGTGCTTGGACGTGTGGGGAATGAACGAATTTTCCTCT
ACATGGGACGCATCGCAGCAGAAAAAAATGTGGAGGCACTGCTGCGCGCTTGGCGGCTGGTAGAGACCAAGGGCTGCCGA
CTGGTCATCGTTGGCGATGGCCCTCTGCGTTCGACCCTGCAAAACAACTCAACCCCAACAAAAGAAAACGACGTGCTCTG
GTGGGGCTATGAGTCAGATCTCAATACCAAGGTGGCCCTACTGCAATGCGCTGAAGTCTTCATGCTGCCAAGCCTGGTCG
AAGGTCTATCTCTGGCACTACTAGAGGCGATGGCAACAGGTACAGCCTGCGTGGCCACAGACGCCGGGGCTGATGGGGAA
GTGTTGGATGGCGGTGCAGGCATCGTCTTAAGCACACAGGGTGTCACCAGCCAATTACGCACCCTGCTGCCGGTGCTCCG
CGATCAGCCCGTACTAACAGCCGAACTGGGCCGCCGCGCCCGTATGCGCGTGCTGGAGCGATACACCATCACCCGCAACA
TCGATGACCTGGAAACGCTCTACCGCGGCTTATTAGGAGCGACAAAGATGGCGGCCTAA

Upstream 100 bases:

>100_bases
AGTGCTGTGGTTGCTTGCTGCACTGGCCCTAGTAGCAGCTTTATTAGAGCGCCCTTGGCAGCGCTGCTAGCTTTCACATT
CGGCAGGAGGATTGCAGCAG

Downstream 100 bases:

>100_bases
CTCAAGCCAGTTCACGGCTACGTTGAGCAGCTGCAACAACCGCCTCAATCAAAGCAGAACGAACCCCTGCCCGCTCAAGC
TTGCGCAGTGCGGCAATCGT

Product: glycosyl transferase, group 1

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 392; Mature: 391

Protein sequence:

>392_residues
MAHIAWLGKKTPFCGNVTYGLNTTEALRQRGHQTSFIHFDTPGGLSNGESALLANDPEVSLPYLVKSQVYTIPFPGAQRE
LRESLERLQPDLVHASLTLSPLDFRLPELCEQIGVPLVATFHPPFDSGMRHLTAGTQQLTYQLYAPALARYDKVIVFSEL
QAEVLTKLGVQEQRLAVIPNGVDPECWAPTSPQCSNPMQQEVLGRVGNERIFLYMGRIAAEKNVEALLRAWRLVETKGCR
LVIVGDGPLRSTLQNNSTPTKENDVLWWGYESDLNTKVALLQCAEVFMLPSLVEGLSLALLEAMATGTACVATDAGADGE
VLDGGAGIVLSTQGVTSQLRTLLPVLRDQPVLTAELGRRARMRVLERYTITRNIDDLETLYRGLLGATKMAA

Sequences:

>Translated_392_residues
MAHIAWLGKKTPFCGNVTYGLNTTEALRQRGHQTSFIHFDTPGGLSNGESALLANDPEVSLPYLVKSQVYTIPFPGAQRE
LRESLERLQPDLVHASLTLSPLDFRLPELCEQIGVPLVATFHPPFDSGMRHLTAGTQQLTYQLYAPALARYDKVIVFSEL
QAEVLTKLGVQEQRLAVIPNGVDPECWAPTSPQCSNPMQQEVLGRVGNERIFLYMGRIAAEKNVEALLRAWRLVETKGCR
LVIVGDGPLRSTLQNNSTPTKENDVLWWGYESDLNTKVALLQCAEVFMLPSLVEGLSLALLEAMATGTACVATDAGADGE
VLDGGAGIVLSTQGVTSQLRTLLPVLRDQPVLTAELGRRARMRVLERYTITRNIDDLETLYRGLLGATKMAA
>Mature_391_residues
AHIAWLGKKTPFCGNVTYGLNTTEALRQRGHQTSFIHFDTPGGLSNGESALLANDPEVSLPYLVKSQVYTIPFPGAQREL
RESLERLQPDLVHASLTLSPLDFRLPELCEQIGVPLVATFHPPFDSGMRHLTAGTQQLTYQLYAPALARYDKVIVFSELQ
AEVLTKLGVQEQRLAVIPNGVDPECWAPTSPQCSNPMQQEVLGRVGNERIFLYMGRIAAEKNVEALLRAWRLVETKGCRL
VIVGDGPLRSTLQNNSTPTKENDVLWWGYESDLNTKVALLQCAEVFMLPSLVEGLSLALLEAMATGTACVATDAGADGEV
LDGGAGIVLSTQGVTSQLRTLLPVLRDQPVLTAELGRRARMRVLERYTITRNIDDLETLYRGLLGATKMAA

Specific function: May be involved in the production of the exopolysaccharide (EPS) component of the extracellular matrix during biofilm formation. EPS is responsible for the adhesion of chains of cells into bundles. Required for biofilm maintenance [H]

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the glycosyltransferase 1 family [H]

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR001296 [H]

Pfam domain/function: PF00534 Glycos_transf_1 [H]

EC number: 2.-.-.- [C]

Molecular weight: Translated: 42967; Mature: 42836

Theoretical pI: Translated: 5.46; Mature: 5.46

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.8 %Cys     (Translated Protein)
2.0 %Met     (Translated Protein)
3.8 %Cys+Met (Translated Protein)
1.8 %Cys     (Mature Protein)
1.8 %Met     (Mature Protein)
3.6 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MAHIAWLGKKTPFCGNVTYGLNTTEALRQRGHQTSFIHFDTPGGLSNGESALLANDPEVS
CCCEEECCCCCCCCCCEEECCCHHHHHHHCCCCCEEEEECCCCCCCCCCCEEEECCCCCC
LPYLVKSQVYTIPFPGAQRELRESLERLQPDLVHASLTLSPLDFRLPELCEQIGVPLVAT
CCEEECCCEEEECCCCCHHHHHHHHHHHCHHHEEEEEEECCCCCCHHHHHHHHCCCEEEE
FHPPFDSGMRHLTAGTQQLTYQLYAPALARYDKVIVFSELQAEVLTKLGVQEQRLAVIPN
ECCCHHHHHHHHHCCHHHHHHHHHHHHHHHHCEEEEEHHHHHHHHHHCCCCCCEEEECCC
GVDPECWAPTSPQCSNPMQQEVLGRVGNERIFLYMGRIAAEKNVEALLRAWRLVETKGCR
CCCCCCCCCCCCCCCCHHHHHHHHHCCCCEEEEEECCHHHHCCHHHHHHHHHHHCCCCCE
LVIVGDGPLRSTLQNNSTPTKENDVLWWGYESDLNTKVALLQCAEVFMLPSLVEGLSLAL
EEEECCCCHHHHHHCCCCCCCCCCEEEEECCCCCCHHHHHHHHHHHHHHHHHHHHHHHHH
LEAMATGTACVATDAGADGEVLDGGAGIVLSTQGVTSQLRTLLPVLRDQPVLTAELGRRA
HHHHHCCCEEEEECCCCCCCEEECCCCEEEECCCHHHHHHHHHHHHCCCCCCHHHHHHHH
RMRVLERYTITRNIDDLETLYRGLLGATKMAA
HHHHHHHHHHHCCCHHHHHHHHHHHHHHHHCC
>Mature Secondary Structure 
AHIAWLGKKTPFCGNVTYGLNTTEALRQRGHQTSFIHFDTPGGLSNGESALLANDPEVS
CCEEECCCCCCCCCCEEECCCHHHHHHHCCCCCEEEEECCCCCCCCCCCEEEECCCCCC
LPYLVKSQVYTIPFPGAQRELRESLERLQPDLVHASLTLSPLDFRLPELCEQIGVPLVAT
CCEEECCCEEEECCCCCHHHHHHHHHHHCHHHEEEEEEECCCCCCHHHHHHHHCCCEEEE
FHPPFDSGMRHLTAGTQQLTYQLYAPALARYDKVIVFSELQAEVLTKLGVQEQRLAVIPN
ECCCHHHHHHHHHCCHHHHHHHHHHHHHHHHCEEEEEHHHHHHHHHHCCCCCCEEEECCC
GVDPECWAPTSPQCSNPMQQEVLGRVGNERIFLYMGRIAAEKNVEALLRAWRLVETKGCR
CCCCCCCCCCCCCCCCHHHHHHHHHCCCCEEEEEECCHHHHCCHHHHHHHHHHHCCCCCE
LVIVGDGPLRSTLQNNSTPTKENDVLWWGYESDLNTKVALLQCAEVFMLPSLVEGLSLAL
EEEECCCCHHHHHHCCCCCCCCCCEEEEECCCCCCHHHHHHHHHHHHHHHHHHHHHHHHH
LEAMATGTACVATDAGADGEVLDGGAGIVLSTQGVTSQLRTLLPVLRDQPVLTAELGRRA
HHHHHCCCEEEEECCCCCCCEEECCCCEEEECCCHHHHHHHHHHHHCCCCCCHHHHHHHH
RMRVLERYTITRNIDDLETLYRGLLGATKMAA
HHHHHHHHHHHCCCHHHHHHHHHHHHHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 8969506; 9384377 [H]