Definition Prochlorococcus marinus str. MIT 9313 chromosome, complete genome.
Accession NC_005071
Length 2,410,873

Click here to switch to the map view.

The map label for this gene is nlpI [C]

Identifier: 33863210

GI number: 33863210

Start: 1019914

End: 1020918

Strand: Reverse

Name: nlpI [C]

Synonym: PMT0938

Alternate gene names: 33863210

Gene position: 1020918-1019914 (Counterclockwise)

Preceding gene: 33863211

Following gene: 33863207

Centisome position: 42.35

GC content: 41.99

Gene sequence:

>1005_bases
ATGTCACGGAAAAGAACTGCACTTGCTGCTTCCTTGTCATTGCTGCAGCTGGGTCAACCGCTGCTACTGGGATCTACAGC
TGCTTTGCTAACTGGTTTGCTGCTGCTTTCAACCCAGGCAGCAGATGCTCAAAGTGCTGTTCTCTACAAAAAGAGCGGTA
ATGCAAAGGTTGGATCAGGAGATTATCAAGCAGCAATTGCTGATTACAACAAGGCAATTGTAATTAATCCAAAGGATGCC
GATGCATACAATAACCGTGGTCTTGCCAAGAGTAAGTCAGGAGATAATCAAGGAGCAATTGCTGATTTCAACAAGGCAAT
AGAGATTAATCCGCAGTATGTCCGTGCCTACAACAATCGTGGTCTTGCCAAGAGTAAGTCAGGAGATAATCAAGGGGCAA
TTGTCGATTATAATATGGCAATAGCAATTAATCCGGTGTATTTATATGGATTTCTCAATCGTGGTCTTGCCAAGAAAAAT
CTCAATAAATATCAAGAAGCAATTGTCGATTACAACAAGGCAATCGTAATTAACCCTCAACTTGCCGTTGCCTACCACAA
GCGTGGTCTTGCCAAGGTTGATTTAAAGGATTATCAAGGGGCAATTGCTGATTTCAACAAGGCAATAACACTTAATCCAA
AGGATGCCGCTGCCTACAACAACCGAGGTGCTGTTAAGGGTAAATCAGGAGATAATCAAGCAGCAATTGCTGATTTCAAC
AAGGCAATTGAGATTGATCTGCAATATGCCGATGCCTACATTAATCGTGGTCTTGCCAAGTATAATTTAGGAGATAATCA
AGGAGCAATTACTGATTACAGCGAGGCAATAAAGATTGATCCGCAGGATGTCTTCGCCTATAACAATCGTGGTTATGTCA
CGTGGAAATTAAAAGATTATCAAAGTGCTTGTAATGACTTCAAGAAAGCAGCATCTCTTGGAAGTCAATCAACAGCACAA
TGGATAAACAGAGTAGATGGTGCCTGGTGCCGCAATATGCGATGA

Upstream 100 bases:

>100_bases
AAAGGAGCAGAAATTCAAAGAGAAGAAGGCTTAAGACTTGACAGCCCACTTCTGATCCCGAAAGGCCCCCATCTACCCTC
AAGCCAGCAGCACATTCCTG

Downstream 100 bases:

>100_bases
GGGGATAAGAAATATCTCCACCTGACCAAATTAATACCCCCACTTACCCTTAAAGCAGCAGCACCCAGCAGATTCCACGC
AGAAGAACGGCACTTGCTAT

Product: TPR repeat-containing protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 334; Mature: 333

Protein sequence:

>334_residues
MSRKRTALAASLSLLQLGQPLLLGSTAALLTGLLLLSTQAADAQSAVLYKKSGNAKVGSGDYQAAIADYNKAIVINPKDA
DAYNNRGLAKSKSGDNQGAIADFNKAIEINPQYVRAYNNRGLAKSKSGDNQGAIVDYNMAIAINPVYLYGFLNRGLAKKN
LNKYQEAIVDYNKAIVINPQLAVAYHKRGLAKVDLKDYQGAIADFNKAITLNPKDAAAYNNRGAVKGKSGDNQAAIADFN
KAIEIDLQYADAYINRGLAKYNLGDNQGAITDYSEAIKIDPQDVFAYNNRGYVTWKLKDYQSACNDFKKAASLGSQSTAQ
WINRVDGAWCRNMR

Sequences:

>Translated_334_residues
MSRKRTALAASLSLLQLGQPLLLGSTAALLTGLLLLSTQAADAQSAVLYKKSGNAKVGSGDYQAAIADYNKAIVINPKDA
DAYNNRGLAKSKSGDNQGAIADFNKAIEINPQYVRAYNNRGLAKSKSGDNQGAIVDYNMAIAINPVYLYGFLNRGLAKKN
LNKYQEAIVDYNKAIVINPQLAVAYHKRGLAKVDLKDYQGAIADFNKAITLNPKDAAAYNNRGAVKGKSGDNQAAIADFN
KAIEIDLQYADAYINRGLAKYNLGDNQGAITDYSEAIKIDPQDVFAYNNRGYVTWKLKDYQSACNDFKKAASLGSQSTAQ
WINRVDGAWCRNMR
>Mature_333_residues
SRKRTALAASLSLLQLGQPLLLGSTAALLTGLLLLSTQAADAQSAVLYKKSGNAKVGSGDYQAAIADYNKAIVINPKDAD
AYNNRGLAKSKSGDNQGAIADFNKAIEINPQYVRAYNNRGLAKSKSGDNQGAIVDYNMAIAINPVYLYGFLNRGLAKKNL
NKYQEAIVDYNKAIVINPQLAVAYHKRGLAKVDLKDYQGAIADFNKAITLNPKDAAAYNNRGAVKGKSGDNQAAIADFNK
AIEIDLQYADAYINRGLAKYNLGDNQGAITDYSEAIKIDPQDVFAYNNRGYVTWKLKDYQSACNDFKKAASLGSQSTAQW
INRVDGAWCRNMR

Specific function: May Be Involved In Cell Division. Overexpression Of Nlpi Results In The Loss Of The Rod Morphology And The Formation Of Single Prolate Ellipsoids And Pairs Of Prolate Ellipsoids Joined By Partial Constrictions. [C]

COG id: NA

COG function: NA

Gene ontology:

Cell location: Attached To The Membrane By A Lipid Anchor [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 4 TPR repeats [H]

Homologues:

Organism=Homo sapiens, GI310110582, Length=205, Percent_Identity=32.6829268292683, Blast_Score=101, Evalue=8e-22,
Organism=Homo sapiens, GI310131789, Length=205, Percent_Identity=32.6829268292683, Blast_Score=101, Evalue=8e-22,
Organism=Homo sapiens, GI310123097, Length=205, Percent_Identity=32.6829268292683, Blast_Score=101, Evalue=1e-21,
Organism=Homo sapiens, GI32307148, Length=265, Percent_Identity=26.7924528301887, Blast_Score=90, Evalue=2e-18,
Organism=Homo sapiens, GI32307150, Length=244, Percent_Identity=28.2786885245902, Blast_Score=90, Evalue=3e-18,
Organism=Homo sapiens, GI167466177, Length=239, Percent_Identity=25.5230125523013, Blast_Score=80, Evalue=2e-15,
Organism=Homo sapiens, GI167466175, Length=239, Percent_Identity=25.5230125523013, Blast_Score=80, Evalue=2e-15,
Organism=Homo sapiens, GI170784867, Length=226, Percent_Identity=26.9911504424779, Blast_Score=76, Evalue=5e-14,
Organism=Homo sapiens, GI7706671, Length=250, Percent_Identity=23.6, Blast_Score=73, Evalue=4e-13,
Organism=Homo sapiens, GI118766330, Length=199, Percent_Identity=24.1206030150754, Blast_Score=70, Evalue=2e-12,
Organism=Homo sapiens, GI118766328, Length=199, Percent_Identity=24.1206030150754, Blast_Score=70, Evalue=2e-12,
Organism=Homo sapiens, GI5803181, Length=244, Percent_Identity=25.8196721311475, Blast_Score=69, Evalue=4e-12,
Organism=Homo sapiens, GI54607135, Length=186, Percent_Identity=28.494623655914, Blast_Score=69, Evalue=8e-12,
Organism=Caenorhabditis elegans, GI115532692, Length=218, Percent_Identity=31.1926605504587, Blast_Score=86, Evalue=2e-17,
Organism=Caenorhabditis elegans, GI115532690, Length=218, Percent_Identity=31.1926605504587, Blast_Score=86, Evalue=4e-17,
Organism=Caenorhabditis elegans, GI17563052, Length=237, Percent_Identity=24.8945147679325, Blast_Score=76, Evalue=3e-14,
Organism=Caenorhabditis elegans, GI25147174, Length=265, Percent_Identity=20.377358490566, Blast_Score=71, Evalue=7e-13,
Organism=Saccharomyces cerevisiae, GI6319387, Length=194, Percent_Identity=26.8041237113402, Blast_Score=70, Evalue=6e-13,
Organism=Drosophila melanogaster, GI17647755, Length=191, Percent_Identity=29.3193717277487, Blast_Score=81, Evalue=1e-15,
Organism=Drosophila melanogaster, GI24585827, Length=191, Percent_Identity=29.3193717277487, Blast_Score=81, Evalue=1e-15,
Organism=Drosophila melanogaster, GI24585829, Length=191, Percent_Identity=29.3193717277487, Blast_Score=81, Evalue=1e-15,
Organism=Drosophila melanogaster, GI24647123, Length=252, Percent_Identity=23.015873015873, Blast_Score=74, Evalue=1e-13,
Organism=Drosophila melanogaster, GI17137540, Length=228, Percent_Identity=24.1228070175439, Blast_Score=67, Evalue=2e-11,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR001440
- InterPro:   IPR013026
- InterPro:   IPR011990
- InterPro:   IPR019734 [H]

Pfam domain/function: PF00515 TPR_1 [H]

EC number: NA

Molecular weight: Translated: 36244; Mature: 36113

Theoretical pI: Translated: 9.83; Mature: 9.83

Prosite motif: PS50005 TPR ; PS50293 TPR_REGION

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.6 %Cys     (Translated Protein)
0.9 %Met     (Translated Protein)
1.5 %Cys+Met (Translated Protein)
0.6 %Cys     (Mature Protein)
0.6 %Met     (Mature Protein)
1.2 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSRKRTALAASLSLLQLGQPLLLGSTAALLTGLLLLSTQAADAQSAVLYKKSGNAKVGSG
CCCCHHHHHHHHHHHHCCCCCEECCHHHHHHHHHHHHCCCCCCCEEEEEECCCCCEECCC
DYQAAIADYNKAIVINPKDADAYNNRGLAKSKSGDNQGAIADFNKAIEINPQYVRAYNNR
CCEEEEECCCCEEEECCCCCCCCCCCCCCCCCCCCCCCCEECCCCEEECCHHHEEEECCC
GLAKSKSGDNQGAIVDYNMAIAINPVYLYGFLNRGLAKKNLNKYQEAIVDYNKAIVINPQ
CCCCCCCCCCCCCEEEEEEEEEECCEEEEEHHHCCHHHHHHHHHHHHHHCCCCEEEECCC
LAVAYHKRGLAKVDLKDYQGAIADFNKAITLNPKDAAAYNNRGAVKGKSGDNQAAIADFN
EEEEEHHCCCEEEEHHHHCCHHHCCCCEEEECCCHHHCCCCCCCEECCCCCCCEEEECCC
KAIEIDLQYADAYINRGLAKYNLGDNQGAITDYSEAIKIDPQDVFAYNNRGYVTWKLKDY
CEEEEEEEEHHHHHHCCEEEECCCCCCCCCCCCCCEEEECHHHEEEECCCCEEEEEEHHH
QSACNDFKKAASLGSQSTAQWINRVDGAWCRNMR
HHHHHHHHHHHHCCCHHHHHHHHHCCCHHHCCCC
>Mature Secondary Structure 
SRKRTALAASLSLLQLGQPLLLGSTAALLTGLLLLSTQAADAQSAVLYKKSGNAKVGSG
CCCHHHHHHHHHHHHCCCCCEECCHHHHHHHHHHHHCCCCCCCEEEEEECCCCCEECCC
DYQAAIADYNKAIVINPKDADAYNNRGLAKSKSGDNQGAIADFNKAIEINPQYVRAYNNR
CCEEEEECCCCEEEECCCCCCCCCCCCCCCCCCCCCCCCEECCCCEEECCHHHEEEECCC
GLAKSKSGDNQGAIVDYNMAIAINPVYLYGFLNRGLAKKNLNKYQEAIVDYNKAIVINPQ
CCCCCCCCCCCCCEEEEEEEEEECCEEEEEHHHCCHHHHHHHHHHHHHHCCCCEEEECCC
LAVAYHKRGLAKVDLKDYQGAIADFNKAITLNPKDAAAYNNRGAVKGKSGDNQAAIADFN
EEEEEHHCCCEEEEHHHHCCHHHCCCCEEEECCCHHHCCCCCCCEECCCCCCCEEEECCC
KAIEIDLQYADAYINRGLAKYNLGDNQGAITDYSEAIKIDPQDVFAYNNRGYVTWKLKDY
CEEEEEEEEHHHHHHCCEEEECCCCCCCCCCCCCCEEEECHHHEEEECCCCEEEEEEHHH
QSACNDFKKAASLGSQSTAQWINRVDGAWCRNMR
HHHHHHHHHHHHCCCHHHHHHHHHCCCHHHCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 7.0

TargetDB status: NA

Availability: NA

References: 1368342; 8905231 [H]