| Definition | Prochlorococcus marinus str. MIT 9303, complete genome. |
|---|---|
| Accession | NC_008820 |
| Length | 2,682,675 |
Click here to switch to the map view.
The map label for this gene is 124024552
Identifier: 124024552
GI number: 124024552
Start: 2533073
End: 2534818
Strand: Reverse
Name: 124024552
Synonym: P9303_28641
Alternate gene names: NA
Gene position: 2534818-2533073 (Counterclockwise)
Preceding gene: 124024553
Following gene: 124024549
Centisome position: 94.49
GC content: 46.05
Gene sequence:
>1746_bases ATGAAAGCTAAGGGTGCTCTTACGGCTGCTGCCCTGTCTTTGCTGCCACTAGGGCAACCACTGCTACTAGGCACTGCTGG CATCACCACAGCAACCACCGCAGTCCTTCTTCAAGCGCTAGCAGCAGTTGCTCAAGATGCTTCTGCTGTTGCCAAGGTCG CCAAGGCAATCACTGTTCGTATAGAAGGAGCAACGCAAGGATCTGGCGTTCTCGTCAAAAAAGACGGCAATCGCTACACA GTTCTCACAGCATGGCATGTGGTCAGCAGCAATAGACCTGGAGAAGAGGTTGGGATCTATACCTCCGATGGCCAGGATCA TCAACTGAAGCAAGGCAGTATCCAACGTTTAGGTGAGATTGATATGGCAGTCCTTACCTTCTCCAGTTCTGGAAATTATG AGGTGGCCTCAATTGGAGATGCAAAAACAGTTCAATACGATGATCCGATCTACGTCGCTGGATTCCCTCTAGCTAATTCA CAAAACCTTCGTTATGAGACTGGAGATGTTGTTGCCAACGCAGAAGTAGGCATTGATCAGGGCTATCAACTGCTGTATGA CAACAAGACAGCCGCTGGAATGAGTGGTGGTGTCCTCCTCAATGCTGATGGAGAGTTGATTGGTCTTCACGGGAGGGGTG AAAAAAATGAATATGCTTCCAATGGGAATGAAGTCTCAATGAAGACTGGTGTCAACCAAGGTGTACCGATTAGTTATTAC AAGCTTTTCCTTAGTGGATCGCCAGTTGTTGTTGCAAACAACACTGCTGCAAATGCTGATGACTACTATGCACAAGTGCT TGCCTCGGCCAATAAGAAAGGAAGAGAGCAGACTATGGTCCGCCTAGCAGATCAGGCATTGAAATTACGCAAAACGGGCT TTGCATACATCATGCGTGCGTATGCGAAGAATGATTTGGGTGATTACCAAGGAGCAATTGATGATCAAAATAATGCCCTC GAGATTAATCCTGATAATGCAGTCGCTTACGTCAATCGTGGATTAGCTAGGAGTAATATGGGTGATCCTAAAAGTGCCCT TTCTGATTTTAGCAAGGCAATAAAGATAGACCCTGCCAATGCGATGGCATTCAGTAATCGGGGTGTTTCTAAGCAGGCGC TAGGAGATCCTCAAGGGGCGCTAGATGATTACAATAAGGCGATAAAGATTGATCCTCGCAATGCAAATGCCTATGCTAAT CGCGGTGTTAACAAGGGCGATTTAGGAGATTATCAAGGAGCAATTGCTGATTACAGCAAGGCAATTGGAATCAATCCGCA GCATTCTGATGCATACTACAACCGTGGTATTGCAAAGCTTGAATCCAAGGATTATCAAGGAGCAATTGCTGATTACAATA AGGCAATAAGGATTGGCACGCAGAATGCGAGGATCTATCTTAATCGTGGTCTTGTCTACGATAATTTAGGCGATTACCAG CGTGCAATTGCTGATTACAATAAGGCAATAGAGCTTGATCCGCAGTATGCTCTTGCCTACGTGAACCGTGGTCTTGCCAA GATTAAATCAGGAGATATTCAAGGAGCAATTGCTGATTCCAATAAGGCAATAGAACTTGATCCGCGTATGGCAAAAGCCT ATGCCAATCGTGGCGCAGCAAAAGGCATGCTAGATGATGCTAAAGGAGGTTGTGCAGATTTCAAAAAAGCAGCATCACTT GGTTCTCAACTAGCGGCTCAATGGTTAAACCGCGCAGATGCTGCCTGGTGTCGTAATATGCGATGA
Upstream 100 bases:
>100_bases GAAGGGCTCAATCGCATCACGACAGAGGGAAGCGGCGATGACGTGAGCGTGGCGATCGATATCCTTGGACAATGAGCACT AGAGAATGAGGGACTACTAG
Downstream 100 bases:
>100_bases TTAATAACAGCTCTTTATTCCTCTGATGCTGAACTGCAGTTTTTGTCTATATTTTCATTAATCATTGGTGCTTCTATTTG CTGGTCAGCACTTTTCAATA
Product: hypothetical protein
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 581; Mature: 581
Protein sequence:
>581_residues MKAKGALTAAALSLLPLGQPLLLGTAGITTATTAVLLQALAAVAQDASAVAKVAKAITVRIEGATQGSGVLVKKDGNRYT VLTAWHVVSSNRPGEEVGIYTSDGQDHQLKQGSIQRLGEIDMAVLTFSSSGNYEVASIGDAKTVQYDDPIYVAGFPLANS QNLRYETGDVVANAEVGIDQGYQLLYDNKTAAGMSGGVLLNADGELIGLHGRGEKNEYASNGNEVSMKTGVNQGVPISYY KLFLSGSPVVVANNTAANADDYYAQVLASANKKGREQTMVRLADQALKLRKTGFAYIMRAYAKNDLGDYQGAIDDQNNAL EINPDNAVAYVNRGLARSNMGDPKSALSDFSKAIKIDPANAMAFSNRGVSKQALGDPQGALDDYNKAIKIDPRNANAYAN RGVNKGDLGDYQGAIADYSKAIGINPQHSDAYYNRGIAKLESKDYQGAIADYNKAIRIGTQNARIYLNRGLVYDNLGDYQ RAIADYNKAIELDPQYALAYVNRGLAKIKSGDIQGAIADSNKAIELDPRMAKAYANRGAAKGMLDDAKGGCADFKKAASL GSQLAAQWLNRADAAWCRNMR
Sequences:
>Translated_581_residues MKAKGALTAAALSLLPLGQPLLLGTAGITTATTAVLLQALAAVAQDASAVAKVAKAITVRIEGATQGSGVLVKKDGNRYT VLTAWHVVSSNRPGEEVGIYTSDGQDHQLKQGSIQRLGEIDMAVLTFSSSGNYEVASIGDAKTVQYDDPIYVAGFPLANS QNLRYETGDVVANAEVGIDQGYQLLYDNKTAAGMSGGVLLNADGELIGLHGRGEKNEYASNGNEVSMKTGVNQGVPISYY KLFLSGSPVVVANNTAANADDYYAQVLASANKKGREQTMVRLADQALKLRKTGFAYIMRAYAKNDLGDYQGAIDDQNNAL EINPDNAVAYVNRGLARSNMGDPKSALSDFSKAIKIDPANAMAFSNRGVSKQALGDPQGALDDYNKAIKIDPRNANAYAN RGVNKGDLGDYQGAIADYSKAIGINPQHSDAYYNRGIAKLESKDYQGAIADYNKAIRIGTQNARIYLNRGLVYDNLGDYQ RAIADYNKAIELDPQYALAYVNRGLAKIKSGDIQGAIADSNKAIELDPRMAKAYANRGAAKGMLDDAKGGCADFKKAASL GSQLAAQWLNRADAAWCRNMR >Mature_581_residues MKAKGALTAAALSLLPLGQPLLLGTAGITTATTAVLLQALAAVAQDASAVAKVAKAITVRIEGATQGSGVLVKKDGNRYT VLTAWHVVSSNRPGEEVGIYTSDGQDHQLKQGSIQRLGEIDMAVLTFSSSGNYEVASIGDAKTVQYDDPIYVAGFPLANS QNLRYETGDVVANAEVGIDQGYQLLYDNKTAAGMSGGVLLNADGELIGLHGRGEKNEYASNGNEVSMKTGVNQGVPISYY KLFLSGSPVVVANNTAANADDYYAQVLASANKKGREQTMVRLADQALKLRKTGFAYIMRAYAKNDLGDYQGAIDDQNNAL EINPDNAVAYVNRGLARSNMGDPKSALSDFSKAIKIDPANAMAFSNRGVSKQALGDPQGALDDYNKAIKIDPRNANAYAN RGVNKGDLGDYQGAIADYSKAIGINPQHSDAYYNRGIAKLESKDYQGAIADYNKAIRIGTQNARIYLNRGLVYDNLGDYQ RAIADYNKAIELDPQYALAYVNRGLAKIKSGDIQGAIADSNKAIELDPRMAKAYANRGAAKGMLDDAKGGCADFKKAASL GSQLAAQWLNRADAAWCRNMR
Specific function: Unknown
COG id: COG0457
COG function: function code R; FOG: TPR repeat
Gene ontology:
Cell location: Cytoplasmic
Metaboloic importance: NA
Operon status: Not Known
Operon components: None
Similarity: Contains 4 TPR repeats [H]
Homologues:
Organism=Homo sapiens, GI310131789, Length=269, Percent_Identity=30.1115241635688, Blast_Score=114, Evalue=2e-25, Organism=Homo sapiens, GI310110582, Length=269, Percent_Identity=30.1115241635688, Blast_Score=114, Evalue=2e-25, Organism=Homo sapiens, GI310123097, Length=269, Percent_Identity=30.1115241635688, Blast_Score=114, Evalue=3e-25, Organism=Homo sapiens, GI32307150, Length=329, Percent_Identity=25.8358662613982, Blast_Score=102, Evalue=1e-21, Organism=Homo sapiens, GI32307148, Length=329, Percent_Identity=25.8358662613982, Blast_Score=102, Evalue=1e-21, Organism=Homo sapiens, GI170784867, Length=227, Percent_Identity=25.5506607929515, Blast_Score=79, Evalue=8e-15, Organism=Homo sapiens, GI54607135, Length=276, Percent_Identity=28.2608695652174, Blast_Score=76, Evalue=7e-14, Organism=Homo sapiens, GI224809432, Length=295, Percent_Identity=25.0847457627119, Blast_Score=76, Evalue=9e-14, Organism=Homo sapiens, GI118766330, Length=203, Percent_Identity=27.0935960591133, Blast_Score=72, Evalue=1e-12, Organism=Homo sapiens, GI118766328, Length=203, Percent_Identity=27.0935960591133, Blast_Score=72, Evalue=2e-12, Organism=Homo sapiens, GI167466177, Length=201, Percent_Identity=26.865671641791, Blast_Score=71, Evalue=2e-12, Organism=Homo sapiens, GI167466175, Length=201, Percent_Identity=26.865671641791, Blast_Score=71, Evalue=2e-12, Organism=Homo sapiens, GI21450645, Length=283, Percent_Identity=23.6749116607774, Blast_Score=71, Evalue=2e-12, Organism=Homo sapiens, GI225735593, Length=273, Percent_Identity=26.7399267399267, Blast_Score=67, Evalue=4e-11, Organism=Homo sapiens, GI225735591, Length=273, Percent_Identity=26.7399267399267, Blast_Score=67, Evalue=5e-11, Organism=Homo sapiens, GI5803181, Length=218, Percent_Identity=27.0642201834862, Blast_Score=66, Evalue=8e-11, Organism=Caenorhabditis elegans, GI115532692, Length=244, Percent_Identity=30.327868852459, Blast_Score=99, Evalue=8e-21, Organism=Caenorhabditis elegans, GI115532690, Length=244, Percent_Identity=30.327868852459, Blast_Score=98, Evalue=9e-21, Organism=Caenorhabditis elegans, GI25147174, Length=275, Percent_Identity=22.9090909090909, Blast_Score=77, Evalue=2e-14, Organism=Drosophila melanogaster, GI17647755, Length=244, Percent_Identity=30.327868852459, Blast_Score=92, Evalue=1e-18, Organism=Drosophila melanogaster, GI24585827, Length=244, Percent_Identity=30.327868852459, Blast_Score=92, Evalue=1e-18, Organism=Drosophila melanogaster, GI24585829, Length=244, Percent_Identity=30.327868852459, Blast_Score=92, Evalue=1e-18, Organism=Drosophila melanogaster, GI24647123, Length=279, Percent_Identity=23.6559139784946, Blast_Score=77, Evalue=4e-14, Organism=Drosophila melanogaster, GI24659892, Length=210, Percent_Identity=25.2380952380952, Blast_Score=74, Evalue=3e-13, Organism=Drosophila melanogaster, GI24583797, Length=233, Percent_Identity=22.7467811158798, Blast_Score=66, Evalue=7e-11, Organism=Drosophila melanogaster, GI24583795, Length=233, Percent_Identity=22.7467811158798, Blast_Score=66, Evalue=7e-11, Organism=Drosophila melanogaster, GI24583793, Length=233, Percent_Identity=22.7467811158798, Blast_Score=66, Evalue=7e-11,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR001440 - InterPro: IPR013026 - InterPro: IPR011990 - InterPro: IPR019734 [H]
Pfam domain/function: PF00515 TPR_1 [H]
EC number: NA
Molecular weight: Translated: 61820; Mature: 61820
Theoretical pI: Translated: 8.64; Mature: 8.64
Prosite motif: PS50005 TPR ; PS50293 TPR_REGION
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.3 %Cys (Translated Protein) 1.9 %Met (Translated Protein) 2.2 %Cys+Met (Translated Protein) 0.3 %Cys (Mature Protein) 1.9 %Met (Mature Protein) 2.2 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MKAKGALTAAALSLLPLGQPLLLGTAGITTATTAVLLQALAAVAQDASAVAKVAKAITVR CCCCHHHHHHHHHHHCCCCCCEEECCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHEEEEE IEGATQGSGVLVKKDGNRYTVLTAWHVVSSNRPGEEVGIYTSDGQDHQLKQGSIQRLGEI EECCCCCCCEEEEECCCEEEEEEEEEEECCCCCCCCEEEEECCCCCCCHHHHHHHHHCCC DMAVLTFSSSGNYEVASIGDAKTVQYDDPIYVAGFPLANSQNLRYETGDVVANAEVGIDQ EEEEEEEECCCCEEEEECCCCCEEEECCCEEEEECCCCCCCCCEEECCCEEEECCCCCCC GYQLLYDNKTAAGMSGGVLLNADGELIGLHGRGEKNEYASNGNEVSMKTGVNQGVPISYY CCEEEECCCCCCCCCCCEEEECCCCEEEECCCCCCCHHCCCCCEEEEECCCCCCCCHHEE KLFLSGSPVVVANNTAANADDYYAQVLASANKKGREQTMVRLADQALKLRKTGFAYIMRA EEEECCCCEEEECCCCCCCHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHH YAKNDLGDYQGAIDDQNNALEINPDNAVAYVNRGLARSNMGDPKSALSDFSKAIKIDPAN HHHCCCHHHCCCCCCCCCEEEECCCCEEEEECCCHHHCCCCCHHHHHHHHHHHEEECCCH AMAFSNRGVSKQALGDPQGALDDYNKAIKIDPRNANAYANRGVNKGDLGDYQGAIADYSK HEEECCCCCCHHHCCCCCCCHHCCCCEEEECCCCCCHHHHCCCCCCCCCCCCCHHHHHHH AIGINPQHSDAYYNRGIAKLESKDYQGAIADYNKAIRIGTQNARIYLNRGLVYDNLGDYQ HCCCCCCCCCHHHHCCHHHHCCCCCCCCHHCCCCEEEEECCCCEEEEECCEEECCCHHHH RAIADYNKAIELDPQYALAYVNRGLAKIKSGDIQGAIADSNKAIELDPRMAKAYANRGAA HHHHHCCCEEECCHHHHHHHHHCCHHHHCCCCCCEEEECCCCEEEECHHHHHHHHCCCCC KGMLDDAKGGCADFKKAASLGSQLAAQWLNRADAAWCRNMR CCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCC >Mature Secondary Structure MKAKGALTAAALSLLPLGQPLLLGTAGITTATTAVLLQALAAVAQDASAVAKVAKAITVR CCCCHHHHHHHHHHHCCCCCCEEECCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHEEEEE IEGATQGSGVLVKKDGNRYTVLTAWHVVSSNRPGEEVGIYTSDGQDHQLKQGSIQRLGEI EECCCCCCCEEEEECCCEEEEEEEEEEECCCCCCCCEEEEECCCCCCCHHHHHHHHHCCC DMAVLTFSSSGNYEVASIGDAKTVQYDDPIYVAGFPLANSQNLRYETGDVVANAEVGIDQ EEEEEEEECCCCEEEEECCCCCEEEECCCEEEEECCCCCCCCCEEECCCEEEECCCCCCC GYQLLYDNKTAAGMSGGVLLNADGELIGLHGRGEKNEYASNGNEVSMKTGVNQGVPISYY CCEEEECCCCCCCCCCCEEEECCCCEEEECCCCCCCHHCCCCCEEEEECCCCCCCCHHEE KLFLSGSPVVVANNTAANADDYYAQVLASANKKGREQTMVRLADQALKLRKTGFAYIMRA EEEECCCCEEEECCCCCCCHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHH YAKNDLGDYQGAIDDQNNALEINPDNAVAYVNRGLARSNMGDPKSALSDFSKAIKIDPAN HHHCCCHHHCCCCCCCCCEEEECCCCEEEEECCCHHHCCCCCHHHHHHHHHHHEEECCCH AMAFSNRGVSKQALGDPQGALDDYNKAIKIDPRNANAYANRGVNKGDLGDYQGAIADYSK HEEECCCCCCHHHCCCCCCCHHCCCCEEEECCCCCCHHHHCCCCCCCCCCCCCHHHHHHH AIGINPQHSDAYYNRGIAKLESKDYQGAIADYNKAIRIGTQNARIYLNRGLVYDNLGDYQ HCCCCCCCCCHHHHCCHHHHCCCCCCCCHHCCCCEEEEECCCCEEEEECCEEECCCHHHH RAIADYNKAIELDPQYALAYVNRGLAKIKSGDIQGAIADSNKAIELDPRMAKAYANRGAA HHHHHCCCEEECCHHHHHHHHHCCHHHHCCCCCCEEEECCCCEEEECHHHHHHHHCCCCC KGMLDDAKGGCADFKKAASLGSQLAAQWLNRADAAWCRNMR CCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 1368342; 8905231 [H]