| Definition | Prochlorococcus marinus str. MIT 9313 chromosome, complete genome. |
|---|---|
| Accession | NC_005071 |
| Length | 2,410,873 |
Click here to switch to the map view.
The map label for this gene is epsD [H]
Identifier: 33862482
GI number: 33862482
Start: 239513
End: 240691
Strand: Reverse
Name: epsD [H]
Synonym: PMT0209
Alternate gene names: 33862482
Gene position: 240691-239513 (Counterclockwise)
Preceding gene: 33862483
Following gene: 33862473
Centisome position: 9.98
GC content: 56.66
Gene sequence:
>1179_bases GTGGCTCACATTGCCTGGCTAGGCAAAAAAACACCGTTCTGCGGCAACGTCACCTACGGTCTCAATACGACTGAGGCCCT AAGACAACGCGGCCATCAGACCAGTTTTATTCACTTCGACACTCCAGGCGGCCTTAGCAACGGCGAGAGCGCACTGTTGG CCAATGACCCAGAAGTGAGCCTTCCATACCTAGTGAAGTCACAGGTTTACACCATTCCCTTCCCTGGAGCGCAGCGAGAA CTCAGAGAATCATTAGAAAGGCTGCAACCCGATCTCGTCCACGCCAGCCTCACCCTTTCCCCCCTCGACTTCCGGCTGCC AGAACTCTGCGAGCAAATCGGTGTGCCATTAGTGGCAACTTTCCACCCACCATTTGATAGCGGCATGCGCCACCTCACGG CTGGCACACAACAGCTCACGTATCAGCTCTACGCCCCTGCCCTGGCTCGCTATGACAAGGTAATCGTCTTCTCCGAGCTG CAAGCTGAGGTTCTTACCAAACTTGGAGTACAGGAACAACGACTCGCCGTGATCCCCAACGGAGTCGATCCTGAATGTTG GGCACCAACAAGTCCCCAATGCAGCAACCCAATGCAGCAAGAGGTGCTTGGACGTGTGGGGAATGAACGAATTTTCCTCT ACATGGGACGCATCGCAGCAGAAAAAAATGTGGAGGCACTGCTGCGCGCTTGGCGGCTGGTAGAGACCAAGGGCTGCCGA CTGGTCATCGTTGGCGATGGCCCTCTGCGTTCGACCCTGCAAAACAACTCAACCCCAACAAAAGAAAACGACGTGCTCTG GTGGGGCTATGAGTCAGATCTCAATACCAAGGTGGCCCTACTGCAATGCGCTGAAGTCTTCATGCTGCCAAGCCTGGTCG AAGGTCTATCTCTGGCACTACTAGAGGCGATGGCAACAGGTACAGCCTGCGTGGCCACAGACGCCGGGGCTGATGGGGAA GTGTTGGATGGCGGTGCAGGCATCGTCTTAAGCACACAGGGTGTCACCAGCCAATTACGCACCCTGCTGCCGGTGCTCCG CGATCAGCCCGTACTAACAGCCGAACTGGGCCGCCGCGCCCGTATGCGCGTGCTGGAGCGATACACCATCACCCGCAACA TCGATGACCTGGAAACGCTCTACCGCGGCTTATTAGGAGCGACAAAGATGGCGGCCTAA
Upstream 100 bases:
>100_bases AGTGCTGTGGTTGCTTGCTGCACTGGCCCTAGTAGCAGCTTTATTAGAGCGCCCTTGGCAGCGCTGCTAGCTTTCACATT CGGCAGGAGGATTGCAGCAG
Downstream 100 bases:
>100_bases CTCAAGCCAGTTCACGGCTACGTTGAGCAGCTGCAACAACCGCCTCAATCAAAGCAGAACGAACCCCTGCCCGCTCAAGC TTGCGCAGTGCGGCAATCGT
Product: glycosyl transferase, group 1
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 392; Mature: 391
Protein sequence:
>392_residues MAHIAWLGKKTPFCGNVTYGLNTTEALRQRGHQTSFIHFDTPGGLSNGESALLANDPEVSLPYLVKSQVYTIPFPGAQRE LRESLERLQPDLVHASLTLSPLDFRLPELCEQIGVPLVATFHPPFDSGMRHLTAGTQQLTYQLYAPALARYDKVIVFSEL QAEVLTKLGVQEQRLAVIPNGVDPECWAPTSPQCSNPMQQEVLGRVGNERIFLYMGRIAAEKNVEALLRAWRLVETKGCR LVIVGDGPLRSTLQNNSTPTKENDVLWWGYESDLNTKVALLQCAEVFMLPSLVEGLSLALLEAMATGTACVATDAGADGE VLDGGAGIVLSTQGVTSQLRTLLPVLRDQPVLTAELGRRARMRVLERYTITRNIDDLETLYRGLLGATKMAA
Sequences:
>Translated_392_residues MAHIAWLGKKTPFCGNVTYGLNTTEALRQRGHQTSFIHFDTPGGLSNGESALLANDPEVSLPYLVKSQVYTIPFPGAQRE LRESLERLQPDLVHASLTLSPLDFRLPELCEQIGVPLVATFHPPFDSGMRHLTAGTQQLTYQLYAPALARYDKVIVFSEL QAEVLTKLGVQEQRLAVIPNGVDPECWAPTSPQCSNPMQQEVLGRVGNERIFLYMGRIAAEKNVEALLRAWRLVETKGCR LVIVGDGPLRSTLQNNSTPTKENDVLWWGYESDLNTKVALLQCAEVFMLPSLVEGLSLALLEAMATGTACVATDAGADGE VLDGGAGIVLSTQGVTSQLRTLLPVLRDQPVLTAELGRRARMRVLERYTITRNIDDLETLYRGLLGATKMAA >Mature_391_residues AHIAWLGKKTPFCGNVTYGLNTTEALRQRGHQTSFIHFDTPGGLSNGESALLANDPEVSLPYLVKSQVYTIPFPGAQREL RESLERLQPDLVHASLTLSPLDFRLPELCEQIGVPLVATFHPPFDSGMRHLTAGTQQLTYQLYAPALARYDKVIVFSELQ AEVLTKLGVQEQRLAVIPNGVDPECWAPTSPQCSNPMQQEVLGRVGNERIFLYMGRIAAEKNVEALLRAWRLVETKGCRL VIVGDGPLRSTLQNNSTPTKENDVLWWGYESDLNTKVALLQCAEVFMLPSLVEGLSLALLEAMATGTACVATDAGADGEV LDGGAGIVLSTQGVTSQLRTLLPVLRDQPVLTAELGRRARMRVLERYTITRNIDDLETLYRGLLGATKMAA
Specific function: May be involved in the production of the exopolysaccharide (EPS) component of the extracellular matrix during biofilm formation. EPS is responsible for the adhesion of chains of cells into bundles. Required for biofilm maintenance [H]
COG id: NA
COG function: NA
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the glycosyltransferase 1 family [H]
Homologues:
None
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR001296 [H]
Pfam domain/function: PF00534 Glycos_transf_1 [H]
EC number: 2.-.-.- [C]
Molecular weight: Translated: 42967; Mature: 42836
Theoretical pI: Translated: 5.46; Mature: 5.46
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.8 %Cys (Translated Protein) 2.0 %Met (Translated Protein) 3.8 %Cys+Met (Translated Protein) 1.8 %Cys (Mature Protein) 1.8 %Met (Mature Protein) 3.6 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MAHIAWLGKKTPFCGNVTYGLNTTEALRQRGHQTSFIHFDTPGGLSNGESALLANDPEVS CCCEEECCCCCCCCCCEEECCCHHHHHHHCCCCCEEEEECCCCCCCCCCCEEEECCCCCC LPYLVKSQVYTIPFPGAQRELRESLERLQPDLVHASLTLSPLDFRLPELCEQIGVPLVAT CCEEECCCEEEECCCCCHHHHHHHHHHHCHHHEEEEEEECCCCCCHHHHHHHHCCCEEEE FHPPFDSGMRHLTAGTQQLTYQLYAPALARYDKVIVFSELQAEVLTKLGVQEQRLAVIPN ECCCHHHHHHHHHCCHHHHHHHHHHHHHHHHCEEEEEHHHHHHHHHHCCCCCCEEEECCC GVDPECWAPTSPQCSNPMQQEVLGRVGNERIFLYMGRIAAEKNVEALLRAWRLVETKGCR CCCCCCCCCCCCCCCCHHHHHHHHHCCCCEEEEEECCHHHHCCHHHHHHHHHHHCCCCCE LVIVGDGPLRSTLQNNSTPTKENDVLWWGYESDLNTKVALLQCAEVFMLPSLVEGLSLAL EEEECCCCHHHHHHCCCCCCCCCCEEEEECCCCCCHHHHHHHHHHHHHHHHHHHHHHHHH LEAMATGTACVATDAGADGEVLDGGAGIVLSTQGVTSQLRTLLPVLRDQPVLTAELGRRA HHHHHCCCEEEEECCCCCCCEEECCCCEEEECCCHHHHHHHHHHHHCCCCCCHHHHHHHH RMRVLERYTITRNIDDLETLYRGLLGATKMAA HHHHHHHHHHHCCCHHHHHHHHHHHHHHHHCC >Mature Secondary Structure AHIAWLGKKTPFCGNVTYGLNTTEALRQRGHQTSFIHFDTPGGLSNGESALLANDPEVS CCEEECCCCCCCCCCEEECCCHHHHHHHCCCCCEEEEECCCCCCCCCCCEEEECCCCCC LPYLVKSQVYTIPFPGAQRELRESLERLQPDLVHASLTLSPLDFRLPELCEQIGVPLVAT CCEEECCCEEEECCCCCHHHHHHHHHHHCHHHEEEEEEECCCCCCHHHHHHHHCCCEEEE FHPPFDSGMRHLTAGTQQLTYQLYAPALARYDKVIVFSELQAEVLTKLGVQEQRLAVIPN ECCCHHHHHHHHHCCHHHHHHHHHHHHHHHHCEEEEEHHHHHHHHHHCCCCCCEEEECCC GVDPECWAPTSPQCSNPMQQEVLGRVGNERIFLYMGRIAAEKNVEALLRAWRLVETKGCR CCCCCCCCCCCCCCCCHHHHHHHHHCCCCEEEEEECCHHHHCCHHHHHHHHHHHCCCCCE LVIVGDGPLRSTLQNNSTPTKENDVLWWGYESDLNTKVALLQCAEVFMLPSLVEGLSLAL EEEECCCCHHHHHHCCCCCCCCCCEEEEECCCCCCHHHHHHHHHHHHHHHHHHHHHHHHH LEAMATGTACVATDAGADGEVLDGGAGIVLSTQGVTSQLRTLLPVLRDQPVLTAELGRRA HHHHHCCCEEEEECCCCCCCEEECCCCEEEECCCHHHHHHHHHHHHCCCCCCHHHHHHHH RMRVLERYTITRNIDDLETLYRGLLGATKMAA HHHHHHHHHHHCCCHHHHHHHHHHHHHHHHCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 8969506; 9384377 [H]