Definition Prochlorococcus marinus str. MIT 9303, complete genome.
Accession NC_008820
Length 2,682,675

Click here to switch to the map view.

The map label for this gene is 124024552

Identifier: 124024552

GI number: 124024552

Start: 2533073

End: 2534818

Strand: Reverse

Name: 124024552

Synonym: P9303_28641

Alternate gene names: NA

Gene position: 2534818-2533073 (Counterclockwise)

Preceding gene: 124024553

Following gene: 124024549

Centisome position: 94.49

GC content: 46.05

Gene sequence:

>1746_bases
ATGAAAGCTAAGGGTGCTCTTACGGCTGCTGCCCTGTCTTTGCTGCCACTAGGGCAACCACTGCTACTAGGCACTGCTGG
CATCACCACAGCAACCACCGCAGTCCTTCTTCAAGCGCTAGCAGCAGTTGCTCAAGATGCTTCTGCTGTTGCCAAGGTCG
CCAAGGCAATCACTGTTCGTATAGAAGGAGCAACGCAAGGATCTGGCGTTCTCGTCAAAAAAGACGGCAATCGCTACACA
GTTCTCACAGCATGGCATGTGGTCAGCAGCAATAGACCTGGAGAAGAGGTTGGGATCTATACCTCCGATGGCCAGGATCA
TCAACTGAAGCAAGGCAGTATCCAACGTTTAGGTGAGATTGATATGGCAGTCCTTACCTTCTCCAGTTCTGGAAATTATG
AGGTGGCCTCAATTGGAGATGCAAAAACAGTTCAATACGATGATCCGATCTACGTCGCTGGATTCCCTCTAGCTAATTCA
CAAAACCTTCGTTATGAGACTGGAGATGTTGTTGCCAACGCAGAAGTAGGCATTGATCAGGGCTATCAACTGCTGTATGA
CAACAAGACAGCCGCTGGAATGAGTGGTGGTGTCCTCCTCAATGCTGATGGAGAGTTGATTGGTCTTCACGGGAGGGGTG
AAAAAAATGAATATGCTTCCAATGGGAATGAAGTCTCAATGAAGACTGGTGTCAACCAAGGTGTACCGATTAGTTATTAC
AAGCTTTTCCTTAGTGGATCGCCAGTTGTTGTTGCAAACAACACTGCTGCAAATGCTGATGACTACTATGCACAAGTGCT
TGCCTCGGCCAATAAGAAAGGAAGAGAGCAGACTATGGTCCGCCTAGCAGATCAGGCATTGAAATTACGCAAAACGGGCT
TTGCATACATCATGCGTGCGTATGCGAAGAATGATTTGGGTGATTACCAAGGAGCAATTGATGATCAAAATAATGCCCTC
GAGATTAATCCTGATAATGCAGTCGCTTACGTCAATCGTGGATTAGCTAGGAGTAATATGGGTGATCCTAAAAGTGCCCT
TTCTGATTTTAGCAAGGCAATAAAGATAGACCCTGCCAATGCGATGGCATTCAGTAATCGGGGTGTTTCTAAGCAGGCGC
TAGGAGATCCTCAAGGGGCGCTAGATGATTACAATAAGGCGATAAAGATTGATCCTCGCAATGCAAATGCCTATGCTAAT
CGCGGTGTTAACAAGGGCGATTTAGGAGATTATCAAGGAGCAATTGCTGATTACAGCAAGGCAATTGGAATCAATCCGCA
GCATTCTGATGCATACTACAACCGTGGTATTGCAAAGCTTGAATCCAAGGATTATCAAGGAGCAATTGCTGATTACAATA
AGGCAATAAGGATTGGCACGCAGAATGCGAGGATCTATCTTAATCGTGGTCTTGTCTACGATAATTTAGGCGATTACCAG
CGTGCAATTGCTGATTACAATAAGGCAATAGAGCTTGATCCGCAGTATGCTCTTGCCTACGTGAACCGTGGTCTTGCCAA
GATTAAATCAGGAGATATTCAAGGAGCAATTGCTGATTCCAATAAGGCAATAGAACTTGATCCGCGTATGGCAAAAGCCT
ATGCCAATCGTGGCGCAGCAAAAGGCATGCTAGATGATGCTAAAGGAGGTTGTGCAGATTTCAAAAAAGCAGCATCACTT
GGTTCTCAACTAGCGGCTCAATGGTTAAACCGCGCAGATGCTGCCTGGTGTCGTAATATGCGATGA

Upstream 100 bases:

>100_bases
GAAGGGCTCAATCGCATCACGACAGAGGGAAGCGGCGATGACGTGAGCGTGGCGATCGATATCCTTGGACAATGAGCACT
AGAGAATGAGGGACTACTAG

Downstream 100 bases:

>100_bases
TTAATAACAGCTCTTTATTCCTCTGATGCTGAACTGCAGTTTTTGTCTATATTTTCATTAATCATTGGTGCTTCTATTTG
CTGGTCAGCACTTTTCAATA

Product: hypothetical protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 581; Mature: 581

Protein sequence:

>581_residues
MKAKGALTAAALSLLPLGQPLLLGTAGITTATTAVLLQALAAVAQDASAVAKVAKAITVRIEGATQGSGVLVKKDGNRYT
VLTAWHVVSSNRPGEEVGIYTSDGQDHQLKQGSIQRLGEIDMAVLTFSSSGNYEVASIGDAKTVQYDDPIYVAGFPLANS
QNLRYETGDVVANAEVGIDQGYQLLYDNKTAAGMSGGVLLNADGELIGLHGRGEKNEYASNGNEVSMKTGVNQGVPISYY
KLFLSGSPVVVANNTAANADDYYAQVLASANKKGREQTMVRLADQALKLRKTGFAYIMRAYAKNDLGDYQGAIDDQNNAL
EINPDNAVAYVNRGLARSNMGDPKSALSDFSKAIKIDPANAMAFSNRGVSKQALGDPQGALDDYNKAIKIDPRNANAYAN
RGVNKGDLGDYQGAIADYSKAIGINPQHSDAYYNRGIAKLESKDYQGAIADYNKAIRIGTQNARIYLNRGLVYDNLGDYQ
RAIADYNKAIELDPQYALAYVNRGLAKIKSGDIQGAIADSNKAIELDPRMAKAYANRGAAKGMLDDAKGGCADFKKAASL
GSQLAAQWLNRADAAWCRNMR

Sequences:

>Translated_581_residues
MKAKGALTAAALSLLPLGQPLLLGTAGITTATTAVLLQALAAVAQDASAVAKVAKAITVRIEGATQGSGVLVKKDGNRYT
VLTAWHVVSSNRPGEEVGIYTSDGQDHQLKQGSIQRLGEIDMAVLTFSSSGNYEVASIGDAKTVQYDDPIYVAGFPLANS
QNLRYETGDVVANAEVGIDQGYQLLYDNKTAAGMSGGVLLNADGELIGLHGRGEKNEYASNGNEVSMKTGVNQGVPISYY
KLFLSGSPVVVANNTAANADDYYAQVLASANKKGREQTMVRLADQALKLRKTGFAYIMRAYAKNDLGDYQGAIDDQNNAL
EINPDNAVAYVNRGLARSNMGDPKSALSDFSKAIKIDPANAMAFSNRGVSKQALGDPQGALDDYNKAIKIDPRNANAYAN
RGVNKGDLGDYQGAIADYSKAIGINPQHSDAYYNRGIAKLESKDYQGAIADYNKAIRIGTQNARIYLNRGLVYDNLGDYQ
RAIADYNKAIELDPQYALAYVNRGLAKIKSGDIQGAIADSNKAIELDPRMAKAYANRGAAKGMLDDAKGGCADFKKAASL
GSQLAAQWLNRADAAWCRNMR
>Mature_581_residues
MKAKGALTAAALSLLPLGQPLLLGTAGITTATTAVLLQALAAVAQDASAVAKVAKAITVRIEGATQGSGVLVKKDGNRYT
VLTAWHVVSSNRPGEEVGIYTSDGQDHQLKQGSIQRLGEIDMAVLTFSSSGNYEVASIGDAKTVQYDDPIYVAGFPLANS
QNLRYETGDVVANAEVGIDQGYQLLYDNKTAAGMSGGVLLNADGELIGLHGRGEKNEYASNGNEVSMKTGVNQGVPISYY
KLFLSGSPVVVANNTAANADDYYAQVLASANKKGREQTMVRLADQALKLRKTGFAYIMRAYAKNDLGDYQGAIDDQNNAL
EINPDNAVAYVNRGLARSNMGDPKSALSDFSKAIKIDPANAMAFSNRGVSKQALGDPQGALDDYNKAIKIDPRNANAYAN
RGVNKGDLGDYQGAIADYSKAIGINPQHSDAYYNRGIAKLESKDYQGAIADYNKAIRIGTQNARIYLNRGLVYDNLGDYQ
RAIADYNKAIELDPQYALAYVNRGLAKIKSGDIQGAIADSNKAIELDPRMAKAYANRGAAKGMLDDAKGGCADFKKAASL
GSQLAAQWLNRADAAWCRNMR

Specific function: Unknown

COG id: COG0457

COG function: function code R; FOG: TPR repeat

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Contains 4 TPR repeats [H]

Homologues:

Organism=Homo sapiens, GI310131789, Length=269, Percent_Identity=30.1115241635688, Blast_Score=114, Evalue=2e-25,
Organism=Homo sapiens, GI310110582, Length=269, Percent_Identity=30.1115241635688, Blast_Score=114, Evalue=2e-25,
Organism=Homo sapiens, GI310123097, Length=269, Percent_Identity=30.1115241635688, Blast_Score=114, Evalue=3e-25,
Organism=Homo sapiens, GI32307150, Length=329, Percent_Identity=25.8358662613982, Blast_Score=102, Evalue=1e-21,
Organism=Homo sapiens, GI32307148, Length=329, Percent_Identity=25.8358662613982, Blast_Score=102, Evalue=1e-21,
Organism=Homo sapiens, GI170784867, Length=227, Percent_Identity=25.5506607929515, Blast_Score=79, Evalue=8e-15,
Organism=Homo sapiens, GI54607135, Length=276, Percent_Identity=28.2608695652174, Blast_Score=76, Evalue=7e-14,
Organism=Homo sapiens, GI224809432, Length=295, Percent_Identity=25.0847457627119, Blast_Score=76, Evalue=9e-14,
Organism=Homo sapiens, GI118766330, Length=203, Percent_Identity=27.0935960591133, Blast_Score=72, Evalue=1e-12,
Organism=Homo sapiens, GI118766328, Length=203, Percent_Identity=27.0935960591133, Blast_Score=72, Evalue=2e-12,
Organism=Homo sapiens, GI167466177, Length=201, Percent_Identity=26.865671641791, Blast_Score=71, Evalue=2e-12,
Organism=Homo sapiens, GI167466175, Length=201, Percent_Identity=26.865671641791, Blast_Score=71, Evalue=2e-12,
Organism=Homo sapiens, GI21450645, Length=283, Percent_Identity=23.6749116607774, Blast_Score=71, Evalue=2e-12,
Organism=Homo sapiens, GI225735593, Length=273, Percent_Identity=26.7399267399267, Blast_Score=67, Evalue=4e-11,
Organism=Homo sapiens, GI225735591, Length=273, Percent_Identity=26.7399267399267, Blast_Score=67, Evalue=5e-11,
Organism=Homo sapiens, GI5803181, Length=218, Percent_Identity=27.0642201834862, Blast_Score=66, Evalue=8e-11,
Organism=Caenorhabditis elegans, GI115532692, Length=244, Percent_Identity=30.327868852459, Blast_Score=99, Evalue=8e-21,
Organism=Caenorhabditis elegans, GI115532690, Length=244, Percent_Identity=30.327868852459, Blast_Score=98, Evalue=9e-21,
Organism=Caenorhabditis elegans, GI25147174, Length=275, Percent_Identity=22.9090909090909, Blast_Score=77, Evalue=2e-14,
Organism=Drosophila melanogaster, GI17647755, Length=244, Percent_Identity=30.327868852459, Blast_Score=92, Evalue=1e-18,
Organism=Drosophila melanogaster, GI24585827, Length=244, Percent_Identity=30.327868852459, Blast_Score=92, Evalue=1e-18,
Organism=Drosophila melanogaster, GI24585829, Length=244, Percent_Identity=30.327868852459, Blast_Score=92, Evalue=1e-18,
Organism=Drosophila melanogaster, GI24647123, Length=279, Percent_Identity=23.6559139784946, Blast_Score=77, Evalue=4e-14,
Organism=Drosophila melanogaster, GI24659892, Length=210, Percent_Identity=25.2380952380952, Blast_Score=74, Evalue=3e-13,
Organism=Drosophila melanogaster, GI24583797, Length=233, Percent_Identity=22.7467811158798, Blast_Score=66, Evalue=7e-11,
Organism=Drosophila melanogaster, GI24583795, Length=233, Percent_Identity=22.7467811158798, Blast_Score=66, Evalue=7e-11,
Organism=Drosophila melanogaster, GI24583793, Length=233, Percent_Identity=22.7467811158798, Blast_Score=66, Evalue=7e-11,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR001440
- InterPro:   IPR013026
- InterPro:   IPR011990
- InterPro:   IPR019734 [H]

Pfam domain/function: PF00515 TPR_1 [H]

EC number: NA

Molecular weight: Translated: 61820; Mature: 61820

Theoretical pI: Translated: 8.64; Mature: 8.64

Prosite motif: PS50005 TPR ; PS50293 TPR_REGION

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.3 %Cys     (Translated Protein)
1.9 %Met     (Translated Protein)
2.2 %Cys+Met (Translated Protein)
0.3 %Cys     (Mature Protein)
1.9 %Met     (Mature Protein)
2.2 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKAKGALTAAALSLLPLGQPLLLGTAGITTATTAVLLQALAAVAQDASAVAKVAKAITVR
CCCCHHHHHHHHHHHCCCCCCEEECCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHEEEEE
IEGATQGSGVLVKKDGNRYTVLTAWHVVSSNRPGEEVGIYTSDGQDHQLKQGSIQRLGEI
EECCCCCCCEEEEECCCEEEEEEEEEEECCCCCCCCEEEEECCCCCCCHHHHHHHHHCCC
DMAVLTFSSSGNYEVASIGDAKTVQYDDPIYVAGFPLANSQNLRYETGDVVANAEVGIDQ
EEEEEEEECCCCEEEEECCCCCEEEECCCEEEEECCCCCCCCCEEECCCEEEECCCCCCC
GYQLLYDNKTAAGMSGGVLLNADGELIGLHGRGEKNEYASNGNEVSMKTGVNQGVPISYY
CCEEEECCCCCCCCCCCEEEECCCCEEEECCCCCCCHHCCCCCEEEEECCCCCCCCHHEE
KLFLSGSPVVVANNTAANADDYYAQVLASANKKGREQTMVRLADQALKLRKTGFAYIMRA
EEEECCCCEEEECCCCCCCHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHH
YAKNDLGDYQGAIDDQNNALEINPDNAVAYVNRGLARSNMGDPKSALSDFSKAIKIDPAN
HHHCCCHHHCCCCCCCCCEEEECCCCEEEEECCCHHHCCCCCHHHHHHHHHHHEEECCCH
AMAFSNRGVSKQALGDPQGALDDYNKAIKIDPRNANAYANRGVNKGDLGDYQGAIADYSK
HEEECCCCCCHHHCCCCCCCHHCCCCEEEECCCCCCHHHHCCCCCCCCCCCCCHHHHHHH
AIGINPQHSDAYYNRGIAKLESKDYQGAIADYNKAIRIGTQNARIYLNRGLVYDNLGDYQ
HCCCCCCCCCHHHHCCHHHHCCCCCCCCHHCCCCEEEEECCCCEEEEECCEEECCCHHHH
RAIADYNKAIELDPQYALAYVNRGLAKIKSGDIQGAIADSNKAIELDPRMAKAYANRGAA
HHHHHCCCEEECCHHHHHHHHHCCHHHHCCCCCCEEEECCCCEEEECHHHHHHHHCCCCC
KGMLDDAKGGCADFKKAASLGSQLAAQWLNRADAAWCRNMR
CCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCC
>Mature Secondary Structure
MKAKGALTAAALSLLPLGQPLLLGTAGITTATTAVLLQALAAVAQDASAVAKVAKAITVR
CCCCHHHHHHHHHHHCCCCCCEEECCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHEEEEE
IEGATQGSGVLVKKDGNRYTVLTAWHVVSSNRPGEEVGIYTSDGQDHQLKQGSIQRLGEI
EECCCCCCCEEEEECCCEEEEEEEEEEECCCCCCCCEEEEECCCCCCCHHHHHHHHHCCC
DMAVLTFSSSGNYEVASIGDAKTVQYDDPIYVAGFPLANSQNLRYETGDVVANAEVGIDQ
EEEEEEEECCCCEEEEECCCCCEEEECCCEEEEECCCCCCCCCEEECCCEEEECCCCCCC
GYQLLYDNKTAAGMSGGVLLNADGELIGLHGRGEKNEYASNGNEVSMKTGVNQGVPISYY
CCEEEECCCCCCCCCCCEEEECCCCEEEECCCCCCCHHCCCCCEEEEECCCCCCCCHHEE
KLFLSGSPVVVANNTAANADDYYAQVLASANKKGREQTMVRLADQALKLRKTGFAYIMRA
EEEECCCCEEEECCCCCCCHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHH
YAKNDLGDYQGAIDDQNNALEINPDNAVAYVNRGLARSNMGDPKSALSDFSKAIKIDPAN
HHHCCCHHHCCCCCCCCCEEEECCCCEEEEECCCHHHCCCCCHHHHHHHHHHHEEECCCH
AMAFSNRGVSKQALGDPQGALDDYNKAIKIDPRNANAYANRGVNKGDLGDYQGAIADYSK
HEEECCCCCCHHHCCCCCCCHHCCCCEEEECCCCCCHHHHCCCCCCCCCCCCCHHHHHHH
AIGINPQHSDAYYNRGIAKLESKDYQGAIADYNKAIRIGTQNARIYLNRGLVYDNLGDYQ
HCCCCCCCCCHHHHCCHHHHCCCCCCCCHHCCCCEEEEECCCCEEEEECCEEECCCHHHH
RAIADYNKAIELDPQYALAYVNRGLAKIKSGDIQGAIADSNKAIELDPRMAKAYANRGAA
HHHHHCCCEEECCHHHHHHHHHCCHHHHCCCCCCEEEECCCCEEEECHHHHHHHHCCCCC
KGMLDDAKGGCADFKKAASLGSQLAAQWLNRADAAWCRNMR
CCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 1368342; 8905231 [H]