Definition Prochlorococcus marinus str. MIT 9303, complete genome.
Accession NC_008820
Length 2,682,675

Click here to switch to the map view.

The map label for this gene is 124023033

Identifier: 124023033

GI number: 124023033

Start: 1133240

End: 1134355

Strand: Reverse

Name: 124023033

Synonym: P9303_13281

Alternate gene names: NA

Gene position: 1134355-1133240 (Counterclockwise)

Preceding gene: 124023036

Following gene: 124023032

Centisome position: 42.28

GC content: 46.15

Gene sequence:

>1116_bases
ATGAGTATTGCTGGTCAGTTTTGTGCTCAAGGAAATATATCAAGTATCGATGTACTGGGATCTGGCAACGTCAATGATAC
TTTTTTAGTGGCCTTGACTGGGACTGAACCTCAGCATTTTGTGCTTCAACGACTCAACACCCATGTGTTTGATCGACCTG
ATCTAGTGATGAAAAACATGCTCAACCTTGTTGAACATGTGGAAAGAAAATTAGCCTCAAATCCATCAGAGCTAACCGGC
AGGAGATGGGAGATCCCAAGAGTTCTACCAGTTCGTGGCTTAGATCAACATTGGATTGAACAAGATGGACAGTTCTGGCG
TTCCATCACCTACATCAACTCCGCTACAACTGTTGAGGTACTCCGCGACTATGAACACGCTAAAGAAATCGGATATGCAC
TTGGCATGTTTCATTACCTCATCAGTGATCTCCCCAACGATGGATTAGCAGACACGCTTGAGAATTTTCACGTTACTCCT
GCTTACTTACAAGAGTTCGACATCGCCCAAACCATAGGATGCAGTGGTAGCGTTACAACTTTGAAGCGAGACTCACGCCT
TAGCTCGGCTATGCATTTCATAGAGACCCGTCGCGCTGGCGTCGATGTACTAGAAGCCGCACTTTGTCGTGGTGAACTAA
AGAAACGTCCCATTCATGGTGATCCGAAGATCAACAATGTCATGATCGACAACCTCACAAGACAGGCGGTGGGGTTGATT
GACCTCGATACCGTCAAGCCTGGCCTGGTTCACTATGACATTGGTGATTGCCTTCGTTCCTGTTGTAATCCAGCAGGAGA
GGAAGCTACCGATATCAGCCAGGTTCAATTTGATCTCTCAGTATGTGAAGCAATCCTTGATGGATACCTATCTGTAGCAA
GAGGCTTCTTGAGTGAAAGGGATTATCACTACATCCCCGAGTGCATCAAATTGATCCCATTTGAACTTGGTTTGCGCTTC
CTTACTGATCACCTCAATGGCAACATCTACTTCAAAACGAAACATCGAAACCAAAACCTTGATCGAGCGGAGGTGCAGTT
CCGCCTCATGGAAAGTATTGAAGCTCAGTGGACCTCTATTGTTGGCTTGGTAGAGCGCCTGAGGAGCCAAAGCTAA

Upstream 100 bases:

>100_bases
CTGATCTCTGGCAAAAGCCTTTAAAAGACATCATCGTTGCTCATAAAGAAACAAGTAAGCAGTCTTGGCCAAATCCCCAC
TCGTGACCAGCAATGCTCTA

Downstream 100 bases:

>100_bases
AGATGGCTCGCCATGCTGTCATGACACGCCAAGTATGCACTCTGGTTCCCTATGAACCAAGGCAGAAACCAAACTTACTA
GTTAGTGCTGAGTTTGTATG

Product: hypothetical protein

Products: NA

Alternate protein names: Mucin-Desulfating Sulfatase; Desulfatase Possibly For Mucin; N-Acetylhexosamine-1-Kinase NahK; Phosphotransferase Family Protein; Phosphotransferase Family; Homoserine/Choline Kinase Family Protein; Desulfatase; Phosphotransferase

Number of amino acids: Translated: 371; Mature: 370

Protein sequence:

>371_residues
MSIAGQFCAQGNISSIDVLGSGNVNDTFLVALTGTEPQHFVLQRLNTHVFDRPDLVMKNMLNLVEHVERKLASNPSELTG
RRWEIPRVLPVRGLDQHWIEQDGQFWRSITYINSATTVEVLRDYEHAKEIGYALGMFHYLISDLPNDGLADTLENFHVTP
AYLQEFDIAQTIGCSGSVTTLKRDSRLSSAMHFIETRRAGVDVLEAALCRGELKKRPIHGDPKINNVMIDNLTRQAVGLI
DLDTVKPGLVHYDIGDCLRSCCNPAGEEATDISQVQFDLSVCEAILDGYLSVARGFLSERDYHYIPECIKLIPFELGLRF
LTDHLNGNIYFKTKHRNQNLDRAEVQFRLMESIEAQWTSIVGLVERLRSQS

Sequences:

>Translated_371_residues
MSIAGQFCAQGNISSIDVLGSGNVNDTFLVALTGTEPQHFVLQRLNTHVFDRPDLVMKNMLNLVEHVERKLASNPSELTG
RRWEIPRVLPVRGLDQHWIEQDGQFWRSITYINSATTVEVLRDYEHAKEIGYALGMFHYLISDLPNDGLADTLENFHVTP
AYLQEFDIAQTIGCSGSVTTLKRDSRLSSAMHFIETRRAGVDVLEAALCRGELKKRPIHGDPKINNVMIDNLTRQAVGLI
DLDTVKPGLVHYDIGDCLRSCCNPAGEEATDISQVQFDLSVCEAILDGYLSVARGFLSERDYHYIPECIKLIPFELGLRF
LTDHLNGNIYFKTKHRNQNLDRAEVQFRLMESIEAQWTSIVGLVERLRSQS
>Mature_370_residues
SIAGQFCAQGNISSIDVLGSGNVNDTFLVALTGTEPQHFVLQRLNTHVFDRPDLVMKNMLNLVEHVERKLASNPSELTGR
RWEIPRVLPVRGLDQHWIEQDGQFWRSITYINSATTVEVLRDYEHAKEIGYALGMFHYLISDLPNDGLADTLENFHVTPA
YLQEFDIAQTIGCSGSVTTLKRDSRLSSAMHFIETRRAGVDVLEAALCRGELKKRPIHGDPKINNVMIDNLTRQAVGLID
LDTVKPGLVHYDIGDCLRSCCNPAGEEATDISQVQFDLSVCEAILDGYLSVARGFLSERDYHYIPECIKLIPFELGLRFL
TDHLNGNIYFKTKHRNQNLDRAEVQFRLMESIEAQWTSIVGLVERLRSQS

Specific function: Unknown

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 41889; Mature: 41758

Theoretical pI: Translated: 5.56; Mature: 5.56

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

2.2 %Cys     (Translated Protein)
1.9 %Met     (Translated Protein)
4.0 %Cys+Met (Translated Protein)
2.2 %Cys     (Mature Protein)
1.6 %Met     (Mature Protein)
3.8 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSIAGQFCAQGNISSIDVLGSGNVNDTFLVALTGTEPQHFVLQRLNTHVFDRPDLVMKNM
CCCCCCHHCCCCCCEEEEEECCCCCCEEEEEEECCCHHHHHHHHHHHHCCCCHHHHHHHH
LNLVEHVERKLASNPSELTGRRWEIPRVLPVRGLDQHWIEQDGQFWRSITYINSATTVEV
HHHHHHHHHHHHCCCHHHCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHCCHHHHHH
LRDYEHAKEIGYALGMFHYLISDLPNDGLADTLENFHVTPAYLQEFDIAQTIGCSGSVTT
HHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHCCCCHHHHHHHHHHHHCCCCCCCHH
LKRDSRLSSAMHFIETRRAGVDVLEAALCRGELKKRPIHGDPKINNVMIDNLTRQAVGLI
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCHHHHHHHHHHCCE
DLDTVKPGLVHYDIGDCLRSCCNPAGEEATDISQVQFDLSVCEAILDGYLSVARGFLSER
EECCCCCCEEEECHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCC
DYHYIPECIKLIPFELGLRFLTDHLNGNIYFKTKHRNQNLDRAEVQFRLMESIEAQWTSI
CCHHHHHHHHHCCHHHHHHHHHHHCCCEEEEEECCCCCCCCHHHHHHHHHHHHHHHHHHH
VGLVERLRSQS
HHHHHHHHCCC
>Mature Secondary Structure 
SIAGQFCAQGNISSIDVLGSGNVNDTFLVALTGTEPQHFVLQRLNTHVFDRPDLVMKNM
CCCCCHHCCCCCCEEEEEECCCCCCEEEEEEECCCHHHHHHHHHHHHCCCCHHHHHHHH
LNLVEHVERKLASNPSELTGRRWEIPRVLPVRGLDQHWIEQDGQFWRSITYINSATTVEV
HHHHHHHHHHHHCCCHHHCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHCCHHHHHH
LRDYEHAKEIGYALGMFHYLISDLPNDGLADTLENFHVTPAYLQEFDIAQTIGCSGSVTT
HHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHCCCCHHHHHHHHHHHHCCCCCCCHH
LKRDSRLSSAMHFIETRRAGVDVLEAALCRGELKKRPIHGDPKINNVMIDNLTRQAVGLI
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCHHHHHHHHHHCCE
DLDTVKPGLVHYDIGDCLRSCCNPAGEEATDISQVQFDLSVCEAILDGYLSVARGFLSER
EECCCCCCEEEECHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCC
DYHYIPECIKLIPFELGLRFLTDHLNGNIYFKTKHRNQNLDRAEVQFRLMESIEAQWTSI
CCHHHHHHHHHCCHHHHHHHHHHHCCCEEEEEECCCCCCCCHHHHHHHHHHHHHHHHHHH
VGLVERLRSQS
HHHHHHHHCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA