| Definition | Prochlorococcus marinus str. MIT 9313 chromosome, complete genome. |
|---|---|
| Accession | NC_005071 |
| Length | 2,410,873 |
Click here to switch to the map view.
The map label for this gene is nlpI [C]
Identifier: 33863210
GI number: 33863210
Start: 1019914
End: 1020918
Strand: Reverse
Name: nlpI [C]
Synonym: PMT0938
Alternate gene names: 33863210
Gene position: 1020918-1019914 (Counterclockwise)
Preceding gene: 33863211
Following gene: 33863207
Centisome position: 42.35
GC content: 41.99
Gene sequence:
>1005_bases ATGTCACGGAAAAGAACTGCACTTGCTGCTTCCTTGTCATTGCTGCAGCTGGGTCAACCGCTGCTACTGGGATCTACAGC TGCTTTGCTAACTGGTTTGCTGCTGCTTTCAACCCAGGCAGCAGATGCTCAAAGTGCTGTTCTCTACAAAAAGAGCGGTA ATGCAAAGGTTGGATCAGGAGATTATCAAGCAGCAATTGCTGATTACAACAAGGCAATTGTAATTAATCCAAAGGATGCC GATGCATACAATAACCGTGGTCTTGCCAAGAGTAAGTCAGGAGATAATCAAGGAGCAATTGCTGATTTCAACAAGGCAAT AGAGATTAATCCGCAGTATGTCCGTGCCTACAACAATCGTGGTCTTGCCAAGAGTAAGTCAGGAGATAATCAAGGGGCAA TTGTCGATTATAATATGGCAATAGCAATTAATCCGGTGTATTTATATGGATTTCTCAATCGTGGTCTTGCCAAGAAAAAT CTCAATAAATATCAAGAAGCAATTGTCGATTACAACAAGGCAATCGTAATTAACCCTCAACTTGCCGTTGCCTACCACAA GCGTGGTCTTGCCAAGGTTGATTTAAAGGATTATCAAGGGGCAATTGCTGATTTCAACAAGGCAATAACACTTAATCCAA AGGATGCCGCTGCCTACAACAACCGAGGTGCTGTTAAGGGTAAATCAGGAGATAATCAAGCAGCAATTGCTGATTTCAAC AAGGCAATTGAGATTGATCTGCAATATGCCGATGCCTACATTAATCGTGGTCTTGCCAAGTATAATTTAGGAGATAATCA AGGAGCAATTACTGATTACAGCGAGGCAATAAAGATTGATCCGCAGGATGTCTTCGCCTATAACAATCGTGGTTATGTCA CGTGGAAATTAAAAGATTATCAAAGTGCTTGTAATGACTTCAAGAAAGCAGCATCTCTTGGAAGTCAATCAACAGCACAA TGGATAAACAGAGTAGATGGTGCCTGGTGCCGCAATATGCGATGA
Upstream 100 bases:
>100_bases AAAGGAGCAGAAATTCAAAGAGAAGAAGGCTTAAGACTTGACAGCCCACTTCTGATCCCGAAAGGCCCCCATCTACCCTC AAGCCAGCAGCACATTCCTG
Downstream 100 bases:
>100_bases GGGGATAAGAAATATCTCCACCTGACCAAATTAATACCCCCACTTACCCTTAAAGCAGCAGCACCCAGCAGATTCCACGC AGAAGAACGGCACTTGCTAT
Product: TPR repeat-containing protein
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 334; Mature: 333
Protein sequence:
>334_residues MSRKRTALAASLSLLQLGQPLLLGSTAALLTGLLLLSTQAADAQSAVLYKKSGNAKVGSGDYQAAIADYNKAIVINPKDA DAYNNRGLAKSKSGDNQGAIADFNKAIEINPQYVRAYNNRGLAKSKSGDNQGAIVDYNMAIAINPVYLYGFLNRGLAKKN LNKYQEAIVDYNKAIVINPQLAVAYHKRGLAKVDLKDYQGAIADFNKAITLNPKDAAAYNNRGAVKGKSGDNQAAIADFN KAIEIDLQYADAYINRGLAKYNLGDNQGAITDYSEAIKIDPQDVFAYNNRGYVTWKLKDYQSACNDFKKAASLGSQSTAQ WINRVDGAWCRNMR
Sequences:
>Translated_334_residues MSRKRTALAASLSLLQLGQPLLLGSTAALLTGLLLLSTQAADAQSAVLYKKSGNAKVGSGDYQAAIADYNKAIVINPKDA DAYNNRGLAKSKSGDNQGAIADFNKAIEINPQYVRAYNNRGLAKSKSGDNQGAIVDYNMAIAINPVYLYGFLNRGLAKKN LNKYQEAIVDYNKAIVINPQLAVAYHKRGLAKVDLKDYQGAIADFNKAITLNPKDAAAYNNRGAVKGKSGDNQAAIADFN KAIEIDLQYADAYINRGLAKYNLGDNQGAITDYSEAIKIDPQDVFAYNNRGYVTWKLKDYQSACNDFKKAASLGSQSTAQ WINRVDGAWCRNMR >Mature_333_residues SRKRTALAASLSLLQLGQPLLLGSTAALLTGLLLLSTQAADAQSAVLYKKSGNAKVGSGDYQAAIADYNKAIVINPKDAD AYNNRGLAKSKSGDNQGAIADFNKAIEINPQYVRAYNNRGLAKSKSGDNQGAIVDYNMAIAINPVYLYGFLNRGLAKKNL NKYQEAIVDYNKAIVINPQLAVAYHKRGLAKVDLKDYQGAIADFNKAITLNPKDAAAYNNRGAVKGKSGDNQAAIADFNK AIEIDLQYADAYINRGLAKYNLGDNQGAITDYSEAIKIDPQDVFAYNNRGYVTWKLKDYQSACNDFKKAASLGSQSTAQW INRVDGAWCRNMR
Specific function: May Be Involved In Cell Division. Overexpression Of Nlpi Results In The Loss Of The Rod Morphology And The Formation Of Single Prolate Ellipsoids And Pairs Of Prolate Ellipsoids Joined By Partial Constrictions. [C]
COG id: NA
COG function: NA
Gene ontology:
Cell location: Attached To The Membrane By A Lipid Anchor [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 4 TPR repeats [H]
Homologues:
Organism=Homo sapiens, GI310110582, Length=205, Percent_Identity=32.6829268292683, Blast_Score=101, Evalue=8e-22, Organism=Homo sapiens, GI310131789, Length=205, Percent_Identity=32.6829268292683, Blast_Score=101, Evalue=8e-22, Organism=Homo sapiens, GI310123097, Length=205, Percent_Identity=32.6829268292683, Blast_Score=101, Evalue=1e-21, Organism=Homo sapiens, GI32307148, Length=265, Percent_Identity=26.7924528301887, Blast_Score=90, Evalue=2e-18, Organism=Homo sapiens, GI32307150, Length=244, Percent_Identity=28.2786885245902, Blast_Score=90, Evalue=3e-18, Organism=Homo sapiens, GI167466177, Length=239, Percent_Identity=25.5230125523013, Blast_Score=80, Evalue=2e-15, Organism=Homo sapiens, GI167466175, Length=239, Percent_Identity=25.5230125523013, Blast_Score=80, Evalue=2e-15, Organism=Homo sapiens, GI170784867, Length=226, Percent_Identity=26.9911504424779, Blast_Score=76, Evalue=5e-14, Organism=Homo sapiens, GI7706671, Length=250, Percent_Identity=23.6, Blast_Score=73, Evalue=4e-13, Organism=Homo sapiens, GI118766330, Length=199, Percent_Identity=24.1206030150754, Blast_Score=70, Evalue=2e-12, Organism=Homo sapiens, GI118766328, Length=199, Percent_Identity=24.1206030150754, Blast_Score=70, Evalue=2e-12, Organism=Homo sapiens, GI5803181, Length=244, Percent_Identity=25.8196721311475, Blast_Score=69, Evalue=4e-12, Organism=Homo sapiens, GI54607135, Length=186, Percent_Identity=28.494623655914, Blast_Score=69, Evalue=8e-12, Organism=Caenorhabditis elegans, GI115532692, Length=218, Percent_Identity=31.1926605504587, Blast_Score=86, Evalue=2e-17, Organism=Caenorhabditis elegans, GI115532690, Length=218, Percent_Identity=31.1926605504587, Blast_Score=86, Evalue=4e-17, Organism=Caenorhabditis elegans, GI17563052, Length=237, Percent_Identity=24.8945147679325, Blast_Score=76, Evalue=3e-14, Organism=Caenorhabditis elegans, GI25147174, Length=265, Percent_Identity=20.377358490566, Blast_Score=71, Evalue=7e-13, Organism=Saccharomyces cerevisiae, GI6319387, Length=194, Percent_Identity=26.8041237113402, Blast_Score=70, Evalue=6e-13, Organism=Drosophila melanogaster, GI17647755, Length=191, Percent_Identity=29.3193717277487, Blast_Score=81, Evalue=1e-15, Organism=Drosophila melanogaster, GI24585827, Length=191, Percent_Identity=29.3193717277487, Blast_Score=81, Evalue=1e-15, Organism=Drosophila melanogaster, GI24585829, Length=191, Percent_Identity=29.3193717277487, Blast_Score=81, Evalue=1e-15, Organism=Drosophila melanogaster, GI24647123, Length=252, Percent_Identity=23.015873015873, Blast_Score=74, Evalue=1e-13, Organism=Drosophila melanogaster, GI17137540, Length=228, Percent_Identity=24.1228070175439, Blast_Score=67, Evalue=2e-11,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR001440 - InterPro: IPR013026 - InterPro: IPR011990 - InterPro: IPR019734 [H]
Pfam domain/function: PF00515 TPR_1 [H]
EC number: NA
Molecular weight: Translated: 36244; Mature: 36113
Theoretical pI: Translated: 9.83; Mature: 9.83
Prosite motif: PS50005 TPR ; PS50293 TPR_REGION
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.6 %Cys (Translated Protein) 0.9 %Met (Translated Protein) 1.5 %Cys+Met (Translated Protein) 0.6 %Cys (Mature Protein) 0.6 %Met (Mature Protein) 1.2 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MSRKRTALAASLSLLQLGQPLLLGSTAALLTGLLLLSTQAADAQSAVLYKKSGNAKVGSG CCCCHHHHHHHHHHHHCCCCCEECCHHHHHHHHHHHHCCCCCCCEEEEEECCCCCEECCC DYQAAIADYNKAIVINPKDADAYNNRGLAKSKSGDNQGAIADFNKAIEINPQYVRAYNNR CCEEEEECCCCEEEECCCCCCCCCCCCCCCCCCCCCCCCEECCCCEEECCHHHEEEECCC GLAKSKSGDNQGAIVDYNMAIAINPVYLYGFLNRGLAKKNLNKYQEAIVDYNKAIVINPQ CCCCCCCCCCCCCEEEEEEEEEECCEEEEEHHHCCHHHHHHHHHHHHHHCCCCEEEECCC LAVAYHKRGLAKVDLKDYQGAIADFNKAITLNPKDAAAYNNRGAVKGKSGDNQAAIADFN EEEEEHHCCCEEEEHHHHCCHHHCCCCEEEECCCHHHCCCCCCCEECCCCCCCEEEECCC KAIEIDLQYADAYINRGLAKYNLGDNQGAITDYSEAIKIDPQDVFAYNNRGYVTWKLKDY CEEEEEEEEHHHHHHCCEEEECCCCCCCCCCCCCCEEEECHHHEEEECCCCEEEEEEHHH QSACNDFKKAASLGSQSTAQWINRVDGAWCRNMR HHHHHHHHHHHHCCCHHHHHHHHHCCCHHHCCCC >Mature Secondary Structure SRKRTALAASLSLLQLGQPLLLGSTAALLTGLLLLSTQAADAQSAVLYKKSGNAKVGSG CCCHHHHHHHHHHHHCCCCCEECCHHHHHHHHHHHHCCCCCCCEEEEEECCCCCEECCC DYQAAIADYNKAIVINPKDADAYNNRGLAKSKSGDNQGAIADFNKAIEINPQYVRAYNNR CCEEEEECCCCEEEECCCCCCCCCCCCCCCCCCCCCCCCEECCCCEEECCHHHEEEECCC GLAKSKSGDNQGAIVDYNMAIAINPVYLYGFLNRGLAKKNLNKYQEAIVDYNKAIVINPQ CCCCCCCCCCCCCEEEEEEEEEECCEEEEEHHHCCHHHHHHHHHHHHHHCCCCEEEECCC LAVAYHKRGLAKVDLKDYQGAIADFNKAITLNPKDAAAYNNRGAVKGKSGDNQAAIADFN EEEEEHHCCCEEEEHHHHCCHHHCCCCEEEECCCHHHCCCCCCCEECCCCCCCEEEECCC KAIEIDLQYADAYINRGLAKYNLGDNQGAITDYSEAIKIDPQDVFAYNNRGYVTWKLKDY CEEEEEEEEHHHHHHCCEEEECCCCCCCCCCCCCCEEEECHHHEEEECCCCEEEEEEHHH QSACNDFKKAASLGSQSTAQWINRVDGAWCRNMR HHHHHHHHHHHHCCCHHHHHHHHHCCCHHHCCCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 7.0
TargetDB status: NA
Availability: NA
References: 1368342; 8905231 [H]