Definition Prochlorococcus marinus str. MIT 9303, complete genome.
Accession NC_008820
Length 2,682,675

Click here to switch to the map view.

The map label for this gene is priA [H]

Identifier: 124022440

GI number: 124022440

Start: 675467

End: 677698

Strand: Direct

Name: priA [H]

Synonym: P9303_07311

Alternate gene names: 124022440

Gene position: 675467-677698 (Clockwise)

Preceding gene: 124022439

Following gene: 124022445

Centisome position: 25.18

GC content: 56.9

Gene sequence:

>2232_bases
GTGGAGGCAGGTCGTGAAGGGCGGTGTTTCACCTATGAAGACAGCAGACGGTTAGGGGTGGATTTAGGGGATCTCGTCGT
CGTTCGCCTGCGGGGACGAAGGATGCAAGGCCTTGTGATGGATCGGCGGATCTCGTCTCCTGTTGATCGTGGGCAGGCCT
CTGGGAGTGAAGCGCCGCCGCGTCACTTAGAGGCCATCGAGGCTCTTGTGCAGTCTGCGGCGGTAGATCCTCTCTGGTTT
GGCTGGATTGAAGCGATGGCTGTTCATTGCCATATCAGTCCATTCCGCATGCTTAAAGCAGCTTTGCCGCCTGGTTGGCT
CGGTCAGCGGCAGTCTCATCAGGCGGAGCCCCGTCGACTCTGGTGGGTTCAACTCGAATCTTCTGCGATCAATCCCCAGA
ATCTTCCTCAGCGTCAGGCTGATTTGCAGGCGGCCTTGGCTGCAGGGGGCGGTGGTGCATGGCAGAGGGATCTTCAGGCT
GCCGGCTTCGGGTCTGGTCTTGTCAATGGCCTCATCAAGCGAGGTCTCATTCGTAGGGAAAAGCGACAACCTACTGATGC
ATCCAACGGGCTTTCCTGCTCAGATGCTTGCGATCAGGATTTGGAGGTGCCTCAGTCTCTGACTGTTGAACAGCAGGAGG
TTGTGGAGGCTTTCCAATCCCAGCCCCTTGGAACTGGGATGCTGCTTTGGGGGGTGACAGGCTCGGGCAAGACAGAGGTT
TATTTGCAGCTTGCGGAAAGAGAGCTGCAAGCTGGTCGTCATTGCTTGATTCTCACGCCGGAGATTGGTTTGATCCCTCA
GTTGGTGGATCGTTTCCGTCGCCGTTTCGGAACCAAGGTTCTGGAATATCACAGTGGCTGTTCCGATCGTGAACGGGTGA
GCACCTGGCGGCAGGGGCTGACTGCGGCAAAGCCATTGGTGGTGGTTGGTACTCGTTCAGCAGTCTTTTTGCCATTGGCA
CCATTGGGTTTGATCGTGCTTGATGAGGAACACGACAGTTCTTACAAGCAGGAGTCACCCATGCCTTGCTACCACGCTCG
TGACATGGCCATGGATAGGGCCAGGCGAACTGGTGCCAGGGTGGTGCTGGGAAGTGCTACGCCTTCGCTTGTCAGCTGGA
AGAACCTCGCTCCTCAAGGCCAGCTTGCCTTGGCTCGACTGACCCGTCGCATTTCCGATCAGCCCTTATCGCCGGTGCAT
GTGGTTGATATGCGACAGGAATTGGCCGATGGCCATCGTCGCTTGATCAGCCGTCCATTGATGGAACGTCTTTCGGCATT
GCCTGAGGCCGGTGAACAGGCGGTGGTGTTGGTGCCACGACGTGGCTACAGCAGTTTTTTGAGTTGTCGTAGCTGTGGAG
AGGTCGTGCAGTGTCCTAACTGCGATGTGGCGCTTACGGTGCATCGCAGTCGTCAAGGGCACCAGTGGTTGCGTTGCCAT
TGGTGTGACCATCGCGCTGAGGTTGAGTCCAGTTGCCATAAATGTGGATCGAAGGCTTTCAAACCCTTCGGTGCAGGCAC
GCAGCGCGTGATGGAGCATCTCGTTGAGGAGCTCCAGGGTCTGAGATTGTTGCGTTTCGATCGTGACAGCACCGGTGGCC
GTGATGGGCATCGCCGTTTACTAGAGCAATTTGCAGCAGGGGAGGCAGATGTGCTGGTTGGCACCCAGATGTTGGCCAAG
GGTATGGATTTGCCTCGGGTCACTCTTGCGGCTGTGTTGGCTGCAGATGGTTTGCTTCATCGCCCTGATTTACAAGCTGG
AGAGCAGAGCTTGCAGCTCTTGATGCAATTGGCTGGTCGTGCAGGACGTGGCGAGCGGCCAGGTCATGTGCTTGTTCAGA
CCTATTGCCCTGATCATCCTGTGATTCACCATTTGGTGGATGGTCGCTATGGCGAGTTTCTGAAAGAAGAGGCCTGTCTT
CGTCATGAGGCTGGTTTGGTGCCTTATAGCCGGGCCTGCTTGTTGCGCTTGTCCGGTGATTCAGCTGCAGCGACAGCCAC
AGCTGCTGCGGTCCTCGCTGAACAGATCAAACCCCTTTGTGATGCTCAGGGTTGGTGTCTTATCGGACCAGCCCCAGCTC
CGATTGCGCGGGTCGCGGGTCGAAGTCGTTGGCAACTGCTATTGCATGGTCCGGAGGAGAGTCCTTTGCCGCTGCCTTCA
GGATCGACTCTTTGGAATGGATTGCCCCGTGGGGTTGCCTTAGCGGTGGACCCAGATCCCATTCAGCTTTGA

Upstream 100 bases:

>100_bases
AACATTGACATTCTAAAAAAAACTTGTGACGCCTGCAAGTCCTGATCCGGCTGAACCGGCCCCCTGCCCTTCCGAATGCT
GCGCAGAGGTGGACGTCTGG

Downstream 100 bases:

>100_bases
TTAGGCCATCATCTTCACTGGTTGATGTTGTTGGAGGTCCGTTCGAGGGGCATTTTGAGCACGCCGAAGCCGAGTCTGAG
CTGAACGGTTTGCAGGATCA

Product: primosomal protein N' (replication factor Y)

Products: NA

Alternate protein names: ATP-dependent helicase priA; Replication factor Y [H]

Number of amino acids: Translated: 743; Mature: 743

Protein sequence:

>743_residues
MEAGREGRCFTYEDSRRLGVDLGDLVVVRLRGRRMQGLVMDRRISSPVDRGQASGSEAPPRHLEAIEALVQSAAVDPLWF
GWIEAMAVHCHISPFRMLKAALPPGWLGQRQSHQAEPRRLWWVQLESSAINPQNLPQRQADLQAALAAGGGGAWQRDLQA
AGFGSGLVNGLIKRGLIRREKRQPTDASNGLSCSDACDQDLEVPQSLTVEQQEVVEAFQSQPLGTGMLLWGVTGSGKTEV
YLQLAERELQAGRHCLILTPEIGLIPQLVDRFRRRFGTKVLEYHSGCSDRERVSTWRQGLTAAKPLVVVGTRSAVFLPLA
PLGLIVLDEEHDSSYKQESPMPCYHARDMAMDRARRTGARVVLGSATPSLVSWKNLAPQGQLALARLTRRISDQPLSPVH
VVDMRQELADGHRRLISRPLMERLSALPEAGEQAVVLVPRRGYSSFLSCRSCGEVVQCPNCDVALTVHRSRQGHQWLRCH
WCDHRAEVESSCHKCGSKAFKPFGAGTQRVMEHLVEELQGLRLLRFDRDSTGGRDGHRRLLEQFAAGEADVLVGTQMLAK
GMDLPRVTLAAVLAADGLLHRPDLQAGEQSLQLLMQLAGRAGRGERPGHVLVQTYCPDHPVIHHLVDGRYGEFLKEEACL
RHEAGLVPYSRACLLRLSGDSAAATATAAAVLAEQIKPLCDAQGWCLIGPAPAPIARVAGRSRWQLLLHGPEESPLPLPS
GSTLWNGLPRGVALAVDPDPIQL

Sequences:

>Translated_743_residues
MEAGREGRCFTYEDSRRLGVDLGDLVVVRLRGRRMQGLVMDRRISSPVDRGQASGSEAPPRHLEAIEALVQSAAVDPLWF
GWIEAMAVHCHISPFRMLKAALPPGWLGQRQSHQAEPRRLWWVQLESSAINPQNLPQRQADLQAALAAGGGGAWQRDLQA
AGFGSGLVNGLIKRGLIRREKRQPTDASNGLSCSDACDQDLEVPQSLTVEQQEVVEAFQSQPLGTGMLLWGVTGSGKTEV
YLQLAERELQAGRHCLILTPEIGLIPQLVDRFRRRFGTKVLEYHSGCSDRERVSTWRQGLTAAKPLVVVGTRSAVFLPLA
PLGLIVLDEEHDSSYKQESPMPCYHARDMAMDRARRTGARVVLGSATPSLVSWKNLAPQGQLALARLTRRISDQPLSPVH
VVDMRQELADGHRRLISRPLMERLSALPEAGEQAVVLVPRRGYSSFLSCRSCGEVVQCPNCDVALTVHRSRQGHQWLRCH
WCDHRAEVESSCHKCGSKAFKPFGAGTQRVMEHLVEELQGLRLLRFDRDSTGGRDGHRRLLEQFAAGEADVLVGTQMLAK
GMDLPRVTLAAVLAADGLLHRPDLQAGEQSLQLLMQLAGRAGRGERPGHVLVQTYCPDHPVIHHLVDGRYGEFLKEEACL
RHEAGLVPYSRACLLRLSGDSAAATATAAAVLAEQIKPLCDAQGWCLIGPAPAPIARVAGRSRWQLLLHGPEESPLPLPS
GSTLWNGLPRGVALAVDPDPIQL
>Mature_743_residues
MEAGREGRCFTYEDSRRLGVDLGDLVVVRLRGRRMQGLVMDRRISSPVDRGQASGSEAPPRHLEAIEALVQSAAVDPLWF
GWIEAMAVHCHISPFRMLKAALPPGWLGQRQSHQAEPRRLWWVQLESSAINPQNLPQRQADLQAALAAGGGGAWQRDLQA
AGFGSGLVNGLIKRGLIRREKRQPTDASNGLSCSDACDQDLEVPQSLTVEQQEVVEAFQSQPLGTGMLLWGVTGSGKTEV
YLQLAERELQAGRHCLILTPEIGLIPQLVDRFRRRFGTKVLEYHSGCSDRERVSTWRQGLTAAKPLVVVGTRSAVFLPLA
PLGLIVLDEEHDSSYKQESPMPCYHARDMAMDRARRTGARVVLGSATPSLVSWKNLAPQGQLALARLTRRISDQPLSPVH
VVDMRQELADGHRRLISRPLMERLSALPEAGEQAVVLVPRRGYSSFLSCRSCGEVVQCPNCDVALTVHRSRQGHQWLRCH
WCDHRAEVESSCHKCGSKAFKPFGAGTQRVMEHLVEELQGLRLLRFDRDSTGGRDGHRRLLEQFAAGEADVLVGTQMLAK
GMDLPRVTLAAVLAADGLLHRPDLQAGEQSLQLLMQLAGRAGRGERPGHVLVQTYCPDHPVIHHLVDGRYGEFLKEEACL
RHEAGLVPYSRACLLRLSGDSAAATATAAAVLAEQIKPLCDAQGWCLIGPAPAPIARVAGRSRWQLLLHGPEESPLPLPS
GSTLWNGLPRGVALAVDPDPIQL

Specific function: Recognizes a specific hairpin sequence on phiX ssDNA. This structure is then recognized and bound by proteins priB and priC. Formation of the primosome proceeds with the subsequent actions of dnaB, dnaC, dnaT and primase. PriA then functions as a helicase

COG id: COG1198

COG function: function code L; Primosomal protein N' (replication factor Y) - superfamily II helicase

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 helicase C-terminal domain [H]

Homologues:

Organism=Escherichia coli, GI1790370, Length=634, Percent_Identity=35.9621451104101, Blast_Score=343, Evalue=2e-95,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR014001
- InterPro:   IPR011545
- InterPro:   IPR001650
- InterPro:   IPR014021
- InterPro:   IPR005259 [H]

Pfam domain/function: PF00270 DEAD; PF00271 Helicase_C [H]

EC number: NA

Molecular weight: Translated: 81470; Mature: 81470

Theoretical pI: Translated: 8.15; Mature: 8.15

Prosite motif: PS00028 ZINC_FINGER_C2H2_1

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

2.7 %Cys     (Translated Protein)
2.0 %Met     (Translated Protein)
4.7 %Cys+Met (Translated Protein)
2.7 %Cys     (Mature Protein)
2.0 %Met     (Mature Protein)
4.7 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MEAGREGRCFTYEDSRRLGVDLGDLVVVRLRGRRMQGLVMDRRISSPVDRGQASGSEAPP
CCCCCCCCEEEECCCCCCCCCHHHHHEEEECCCCHHHHHHHHHHCCCHHHCCCCCCCCCH
RHLEAIEALVQSAAVDPLWFGWIEAMAVHCHISPFRMLKAALPPGWLGQRQSHQAEPRRL
HHHHHHHHHHHHHCCCHHHHHHHHHHHHHCCCCHHHHHHHHCCCCCCCCCCCCCCCCCEE
WWVQLESSAINPQNLPQRQADLQAALAAGGGGAWQRDLQAAGFGSGLVNGLIKRGLIRRE
EEEEEECCCCCCCCCCHHHHHHHHHHHCCCCCHHHHHHHHCCCCHHHHHHHHHHHHHHHH
KRQPTDASNGLSCSDACDQDLEVPQSLTVEQQEVVEAFQSQPLGTGMLLWGVTGSGKTEV
HCCCCCCCCCCCCHHHCCCCCCCCCCCCCCHHHHHHHHHCCCCCCCEEEEEECCCCCCHH
YLQLAERELQAGRHCLILTPEIGLIPQLVDRFRRRFGTKVLEYHSGCSDRERVSTWRQGL
HHHHHHHHHHCCCEEEEECCCCCHHHHHHHHHHHHHCHHHHHHHCCCCHHHHHHHHHHCC
TAAKPLVVVGTRSAVFLPLAPLGLIVLDEEHDSSYKQESPMPCYHARDMAMDRARRTGAR
HHCCCEEEEECCCEEEEEECCCCEEEEECCCCCCCCCCCCCCCHHHHHHHHHHHHCCCCE
VVLGSATPSLVSWKNLAPQGQLALARLTRRISDQPLSPVHVVDMRQELADGHRRLISRPL
EEECCCCCCHHHHHCCCCCCHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHHHH
MERLSALPEAGEQAVVLVPRRGYSSFLSCRSCGEVVQCPNCDVALTVHRSRQGHQWLRCH
HHHHHHCCCCCCCEEEEEECCCHHHHHHHHHCCHHHCCCCCCEEEEECCCCCCCCEEEEE
WCDHRAEVESSCHKCGSKAFKPFGAGTQRVMEHLVEELQGLRLLRFDRDSTGGRDGHRRL
ECCHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHCCCEEEEECCCCCCCCHHHHHH
LEQFAAGEADVLVGTQMLAKGMDLPRVTLAAVLAADGLLHRPDLQAGEQSLQLLMQLAGR
HHHHHCCCCHHHHHHHHHHCCCCCCHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHCC
AGRGERPGHVLVQTYCPDHPVIHHLVDGRYGEFLKEEACLRHEAGLVPYSRACLLRLSGD
CCCCCCCCEEEEEECCCCCHHHHHHHCCHHHHHHHHHHHHHHHCCCCCCCCEEEEEECCC
SAAATATAAAVLAEQIKPLCDAQGWCLIGPAPAPIARVAGRSRWQLLLHGPEESPLPLPS
CHHHHHHHHHHHHHHHHHHHCCCCEEEECCCCCHHHHHCCCCEEEEEEECCCCCCCCCCC
GSTLWNGLPRGVALAVDPDPIQL
CCHHHCCCCCCEEEEECCCCCCC
>Mature Secondary Structure
MEAGREGRCFTYEDSRRLGVDLGDLVVVRLRGRRMQGLVMDRRISSPVDRGQASGSEAPP
CCCCCCCCEEEECCCCCCCCCHHHHHEEEECCCCHHHHHHHHHHCCCHHHCCCCCCCCCH
RHLEAIEALVQSAAVDPLWFGWIEAMAVHCHISPFRMLKAALPPGWLGQRQSHQAEPRRL
HHHHHHHHHHHHHCCCHHHHHHHHHHHHHCCCCHHHHHHHHCCCCCCCCCCCCCCCCCEE
WWVQLESSAINPQNLPQRQADLQAALAAGGGGAWQRDLQAAGFGSGLVNGLIKRGLIRRE
EEEEEECCCCCCCCCCHHHHHHHHHHHCCCCCHHHHHHHHCCCCHHHHHHHHHHHHHHHH
KRQPTDASNGLSCSDACDQDLEVPQSLTVEQQEVVEAFQSQPLGTGMLLWGVTGSGKTEV
HCCCCCCCCCCCCHHHCCCCCCCCCCCCCCHHHHHHHHHCCCCCCCEEEEEECCCCCCHH
YLQLAERELQAGRHCLILTPEIGLIPQLVDRFRRRFGTKVLEYHSGCSDRERVSTWRQGL
HHHHHHHHHHCCCEEEEECCCCCHHHHHHHHHHHHHCHHHHHHHCCCCHHHHHHHHHHCC
TAAKPLVVVGTRSAVFLPLAPLGLIVLDEEHDSSYKQESPMPCYHARDMAMDRARRTGAR
HHCCCEEEEECCCEEEEEECCCCEEEEECCCCCCCCCCCCCCCHHHHHHHHHHHHCCCCE
VVLGSATPSLVSWKNLAPQGQLALARLTRRISDQPLSPVHVVDMRQELADGHRRLISRPL
EEECCCCCCHHHHHCCCCCCHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHHHH
MERLSALPEAGEQAVVLVPRRGYSSFLSCRSCGEVVQCPNCDVALTVHRSRQGHQWLRCH
HHHHHHCCCCCCCEEEEEECCCHHHHHHHHHCCHHHCCCCCCEEEEECCCCCCCCEEEEE
WCDHRAEVESSCHKCGSKAFKPFGAGTQRVMEHLVEELQGLRLLRFDRDSTGGRDGHRRL
ECCHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHCCCEEEEECCCCCCCCHHHHHH
LEQFAAGEADVLVGTQMLAKGMDLPRVTLAAVLAADGLLHRPDLQAGEQSLQLLMQLAGR
HHHHHCCCCHHHHHHHHHHCCCCCCHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHCC
AGRGERPGHVLVQTYCPDHPVIHHLVDGRYGEFLKEEACLRHEAGLVPYSRACLLRLSGD
CCCCCCCCEEEEEECCCCCHHHHHHHCCHHHHHHHHHHHHHHHCCCCCCCCEEEEEECCC
SAAATATAAAVLAEQIKPLCDAQGWCLIGPAPAPIARVAGRSRWQLLLHGPEESPLPLPS
CHHHHHHHHHHHHHHHHHHHCCCCEEEECCCCCHHHHHCCCCEEEEEEECCCCCCCCCCC
GSTLWNGLPRGVALAVDPDPIQL
CCHHHCCCCCCEEEEECCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 8905231 [H]