| Definition | Prochlorococcus marinus str. MIT 9515, complete genome. |
|---|---|
| Accession | NC_008817 |
| Length | 1,704,176 |
Click here to switch to the map view.
The map label for this gene is rpoC1 [H]
Identifier: 123966897
GI number: 123966897
Start: 1455510
End: 1457414
Strand: Reverse
Name: rpoC1 [H]
Synonym: P9515_16641
Alternate gene names: 123966897
Gene position: 1457414-1455510 (Counterclockwise)
Preceding gene: 123966898
Following gene: 123966896
Centisome position: 85.52
GC content: 35.96
Gene sequence:
>1905_bases ATGACTAACAGCAACTTAAGAACAGAAAACCATTTTGATTACGTCAAGATTTCTATTGCCTCACCACAAAGAATTATGGA TTGGGGGCAAAGGACCTTACCAAATGGACAAGTAGTAGGAGAGGTTACTAAACCCGAGACAATCAACTATAGAACCTTAA AACCAGAAATGGACGGTCTTTTTTGTGAAAAAATATTTGGACCATCTAAAGATTGGGAATGTCACTGCGGTAAATATAAA AGAGTCAGACATCGTGGAATTGTTTGCGAGAGATGTGGGGTAGAAGTAACTGAAAGTAGAGTAAGAAGACATAGAATGGG TTACATAAAATTGGCAGCCCCAGTTTCCCATGTTTGGTATTTAAAGGGTATTCCCAGTTATGTGGCAATTCTTCTAGATA TCCCGCTTAGAGATGTCGAACAGATAGTTTATTTCAATTGTTATGTTGTTTTAGATGTTGGTGATCATAAAGATCTTAAA TATAAGCAACTTCTTACTGAAGACGAATGGTTAGAGATAGAGGATGAAATTTATGCAGAAGATTCAACGATTGAAAATGA ACCATTTGTGGGTATAGGTGCAGAAGCTCTTAAGCAATTATTAGAGGATCTTGATTTAAATCAGATTGCCGAAGAACTTA GAGAAGAAATCACAAACAGTAAAGGTCAAAAAAGAGCAAAACTTATTAAAAGAATAAGAGTAATTGATAATTTCATAGCA ACAAATGCGAAGCCCGAATGGATGGTATTAGATGCTATTCCTGTCATTCCTCCTGATCTTAGACCAATGGTTCAGCTCGA TGGTGGAAGGTTCGCGACATCTGATCTTAATGATCTTTATAGAAGAGTTATCAATAGAAACAATAGGCTAGCAAGGCTTC AAGAAATTTTAGCTCCTGAAATCATTGTTAGAAATGAAAAAAGAATGTTGCAAGAAGCCGTTGATGCACTTATTGATAAT GGAAGAAGAGGAAGAACAGTTGTTGGTGCAAATAATAGAGCTTTAAAATCTCTTAGCGATATCATCGAGGGCAAGCAAGG CAGATTTAGACAGAATTTACTTGGTAAACGTGTTGATTATTCTGGAAGGTCTGTCATAGTTGTTGGCCCAAAGTTAAAGA TGCATCAATGCGGACTCCCTAAAGAGATGGCTATTGAGCTTTTTCAACCTTTCGTGATACATAGATTAATACGTCAAAAT ATCGTCAATAATATAAAAGCTGCCAAAAAATTAATACAAAAAGCAGATGATGAAGTCATGCAAGTACTTCAAGAAGTTAT TGAAGGACATCCCATACTTTTAAATAGAGCTCCAACTCTTCATAGGTTAGGAATTCAGGCTTTTGAACCTAAATTAGTAG GTGGTAGAGCTATTCAACTACATCCACTTGTATGTCCTGCATTTAATGCTGACTTTGATGGAGATCAAATGGCAGTTCAC GTTCCTTTAGCATTAGAAGCTCAAACAGAGGCGCGTATGCTTATGCTAGCTAGTAATAACATTCTCTCACCAGCAACAGG AGAACCAATCGTAACTCCTTCACAAGATATGGTTTTAGGTTCTTATTATTTAACCGCACTGCAACCAAATTTCAAAAAAC CAAATTTTGGTGATAATCAAAGAACTTACGCCTCACTAGAAGATGTAATTTTTGCTTTTGAAGATAAAAGAGTTGGTTTA CATGAGTGGGTTTGGTTAAGGTTTAACGGCGAAGTTGATGATGATGAAGAATCTAAGACGCCACAAGAAACTAAAGAATT GGAAGATGGCTCCAAATTAGAAATTTGGAATTTTAGAAGAGATAGATTTGATTCCCAAAATAATCTAATAAGTAGATTTA TTTTAACAACAGTCGGAAGGGTGGTTATGAATCATACGATCATTGATTCTGTCTCCAAAACGTGA
Upstream 100 bases:
>100_bases GGAATACTCCTTCGAGGCCTACCTATGAATCTCTAGGAACCTCTGAATATGAGGAAGATTAAATACTTTATCAAAACTTT CTAATTTAAATCTCCTAAAA
Downstream 100 bases:
>100_bases TCCTTTAAAAAAAAAACTAATTATTTATCCATAAAACAATGACATCATCTAAACCAAAAAAAAGTTCAAGAGTACGTAAA ACTTCAAAAAATTCAAAAAA
Product: DNA-directed RNA polymerase subunit gamma
Products: NA
Alternate protein names: RNAP subunit gamma; RNA polymerase subunit gamma; Transcriptase subunit gamma [H]
Number of amino acids: Translated: 634; Mature: 633
Protein sequence:
>634_residues MTNSNLRTENHFDYVKISIASPQRIMDWGQRTLPNGQVVGEVTKPETINYRTLKPEMDGLFCEKIFGPSKDWECHCGKYK RVRHRGIVCERCGVEVTESRVRRHRMGYIKLAAPVSHVWYLKGIPSYVAILLDIPLRDVEQIVYFNCYVVLDVGDHKDLK YKQLLTEDEWLEIEDEIYAEDSTIENEPFVGIGAEALKQLLEDLDLNQIAEELREEITNSKGQKRAKLIKRIRVIDNFIA TNAKPEWMVLDAIPVIPPDLRPMVQLDGGRFATSDLNDLYRRVINRNNRLARLQEILAPEIIVRNEKRMLQEAVDALIDN GRRGRTVVGANNRALKSLSDIIEGKQGRFRQNLLGKRVDYSGRSVIVVGPKLKMHQCGLPKEMAIELFQPFVIHRLIRQN IVNNIKAAKKLIQKADDEVMQVLQEVIEGHPILLNRAPTLHRLGIQAFEPKLVGGRAIQLHPLVCPAFNADFDGDQMAVH VPLALEAQTEARMLMLASNNILSPATGEPIVTPSQDMVLGSYYLTALQPNFKKPNFGDNQRTYASLEDVIFAFEDKRVGL HEWVWLRFNGEVDDDEESKTPQETKELEDGSKLEIWNFRRDRFDSQNNLISRFILTTVGRVVMNHTIIDSVSKT
Sequences:
>Translated_634_residues MTNSNLRTENHFDYVKISIASPQRIMDWGQRTLPNGQVVGEVTKPETINYRTLKPEMDGLFCEKIFGPSKDWECHCGKYK RVRHRGIVCERCGVEVTESRVRRHRMGYIKLAAPVSHVWYLKGIPSYVAILLDIPLRDVEQIVYFNCYVVLDVGDHKDLK YKQLLTEDEWLEIEDEIYAEDSTIENEPFVGIGAEALKQLLEDLDLNQIAEELREEITNSKGQKRAKLIKRIRVIDNFIA TNAKPEWMVLDAIPVIPPDLRPMVQLDGGRFATSDLNDLYRRVINRNNRLARLQEILAPEIIVRNEKRMLQEAVDALIDN GRRGRTVVGANNRALKSLSDIIEGKQGRFRQNLLGKRVDYSGRSVIVVGPKLKMHQCGLPKEMAIELFQPFVIHRLIRQN IVNNIKAAKKLIQKADDEVMQVLQEVIEGHPILLNRAPTLHRLGIQAFEPKLVGGRAIQLHPLVCPAFNADFDGDQMAVH VPLALEAQTEARMLMLASNNILSPATGEPIVTPSQDMVLGSYYLTALQPNFKKPNFGDNQRTYASLEDVIFAFEDKRVGL HEWVWLRFNGEVDDDEESKTPQETKELEDGSKLEIWNFRRDRFDSQNNLISRFILTTVGRVVMNHTIIDSVSKT >Mature_633_residues TNSNLRTENHFDYVKISIASPQRIMDWGQRTLPNGQVVGEVTKPETINYRTLKPEMDGLFCEKIFGPSKDWECHCGKYKR VRHRGIVCERCGVEVTESRVRRHRMGYIKLAAPVSHVWYLKGIPSYVAILLDIPLRDVEQIVYFNCYVVLDVGDHKDLKY KQLLTEDEWLEIEDEIYAEDSTIENEPFVGIGAEALKQLLEDLDLNQIAEELREEITNSKGQKRAKLIKRIRVIDNFIAT NAKPEWMVLDAIPVIPPDLRPMVQLDGGRFATSDLNDLYRRVINRNNRLARLQEILAPEIIVRNEKRMLQEAVDALIDNG RRGRTVVGANNRALKSLSDIIEGKQGRFRQNLLGKRVDYSGRSVIVVGPKLKMHQCGLPKEMAIELFQPFVIHRLIRQNI VNNIKAAKKLIQKADDEVMQVLQEVIEGHPILLNRAPTLHRLGIQAFEPKLVGGRAIQLHPLVCPAFNADFDGDQMAVHV PLALEAQTEARMLMLASNNILSPATGEPIVTPSQDMVLGSYYLTALQPNFKKPNFGDNQRTYASLEDVIFAFEDKRVGLH EWVWLRFNGEVDDDEESKTPQETKELEDGSKLEIWNFRRDRFDSQNNLISRFILTTVGRVVMNHTIIDSVSKT
Specific function: DNA-dependent RNA polymerase catalyzes the transcription of DNA into RNA using the four ribonucleoside triphosphates as substrates [H]
COG id: COG0086
COG function: function code K; DNA-directed RNA polymerase, beta' subunit/160 kD subunit
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the RNA polymerase beta' chain family. RpoC1 subfamily [H]
Homologues:
Organism=Homo sapiens, GI4505939, Length=492, Percent_Identity=26.6260162601626, Blast_Score=150, Evalue=3e-36, Organism=Homo sapiens, GI39725938, Length=321, Percent_Identity=28.9719626168224, Blast_Score=128, Evalue=2e-29, Organism=Homo sapiens, GI103471997, Length=234, Percent_Identity=29.4871794871795, Blast_Score=97, Evalue=6e-20, Organism=Escherichia coli, GI2367335, Length=524, Percent_Identity=62.2137404580153, Blast_Score=694, Evalue=0.0, Organism=Caenorhabditis elegans, GI25145495, Length=308, Percent_Identity=32.1428571428571, Blast_Score=149, Evalue=3e-36, Organism=Caenorhabditis elegans, GI71987878, Length=305, Percent_Identity=30.8196721311475, Blast_Score=141, Evalue=8e-34, Organism=Caenorhabditis elegans, GI71998295, Length=347, Percent_Identity=24.4956772334294, Blast_Score=96, Evalue=6e-20, Organism=Saccharomyces cerevisiae, GI6320061, Length=497, Percent_Identity=27.1629778672032, Blast_Score=144, Evalue=4e-35, Organism=Saccharomyces cerevisiae, GI6324690, Length=227, Percent_Identity=36.1233480176211, Blast_Score=137, Evalue=4e-33, Organism=Saccharomyces cerevisiae, GI6324917, Length=301, Percent_Identity=24.5847176079734, Blast_Score=98, Evalue=4e-21, Organism=Drosophila melanogaster, GI17530899, Length=310, Percent_Identity=29.6774193548387, Blast_Score=139, Evalue=4e-33, Organism=Drosophila melanogaster, GI281360912, Length=503, Percent_Identity=26.2425447316103, Blast_Score=127, Evalue=3e-29, Organism=Drosophila melanogaster, GI17647875, Length=348, Percent_Identity=27.5862068965517, Blast_Score=109, Evalue=6e-24,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR000722 - InterPro: IPR006592 - InterPro: IPR007080 - InterPro: IPR007066 - InterPro: IPR012755 [H]
Pfam domain/function: PF04997 RNA_pol_Rpb1_1; PF00623 RNA_pol_Rpb1_2; PF04983 RNA_pol_Rpb1_3 [H]
EC number: =2.7.7.6 [H]
Molecular weight: Translated: 72500; Mature: 72369
Theoretical pI: Translated: 6.88; Mature: 6.88
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.3 %Cys (Translated Protein) 2.4 %Met (Translated Protein) 3.6 %Cys+Met (Translated Protein) 1.3 %Cys (Mature Protein) 2.2 %Met (Mature Protein) 3.5 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MTNSNLRTENHFDYVKISIASPQRIMDWGQRTLPNGQVVGEVTKPETINYRTLKPEMDGL CCCCCCCCCCCCCEEEEEECCCHHHHHHHHHCCCCCCEEEECCCCCCCCEEEECCCCCCH FCEKIFGPSKDWECHCGKYKRVRHRGIVCERCGVEVTESRVRRHRMGYIKLAAPVSHVWY HHHHHCCCCCCCCCCCCHHHHHHHCCCCHHHCCCHHHHHHHHHHHCCEEEEECCHHHHHH LKGIPSYVAILLDIPLRDVEQIVYFNCYVVLDVGDHKDLKYKQLLTEDEWLEIEDEIYAE HCCHHHHHHHHHHCCHHHHHHEEEEEEEEEEECCCCCCCHHHHHCCCCCCEEECHHHCCC DSTIENEPFVGIGAEALKQLLEDLDLNQIAEELREEITNSKGQKRAKLIKRIRVIDNFIA CCCCCCCCCCCCCHHHHHHHHHHCCHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHH TNAKPEWMVLDAIPVIPPDLRPMVQLDGGRFATSDLNDLYRRVINRNNRLARLQEILAPE CCCCCCEEEEECCCCCCCCCCCEEEECCCEEECCHHHHHHHHHHCCCCHHHHHHHHHCCH IIVRNEKRMLQEAVDALIDNGRRGRTVVGANNRALKSLSDIIEGKQGRFRQNLLGKRVDY HEECCHHHHHHHHHHHHHHCCCCCCEEECCCCHHHHHHHHHHCCCCCHHHHHHHCCCCCC SGRSVIVVGPKLKMHQCGLPKEMAIELFQPFVIHRLIRQNIVNNIKAAKKLIQKADDEVM CCCEEEEECCCCCHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHH QVLQEVIEGHPILLNRAPTLHRLGIQAFEPKLVGGRAIQLHPLVCPAFNADFDGDQMAVH HHHHHHHCCCCEEEECCCCHHHHCCHHCCCEEECCEEEEEECEECCCCCCCCCCCCEEEE VPLALEAQTEARMLMLASNNILSPATGEPIVTPSQDMVLGSYYLTALQPNFKKPNFGDNQ EEEEEECCCCCEEEEEECCCCCCCCCCCCCCCCCCCCEEHHHHHEEECCCCCCCCCCCCC RTYASLEDVIFAFEDKRVGLHEWVWLRFNGEVDDDEESKTPQETKELEDGSKLEIWNFRR HHHHHHHHHHEEECCCCCCCEEEEEEEECCCCCCCCCCCCCHHHHHCCCCCEEEEEECHH DRFDSQNNLISRFILTTVGRVVMNHTIIDSVSKT HHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCC >Mature Secondary Structure TNSNLRTENHFDYVKISIASPQRIMDWGQRTLPNGQVVGEVTKPETINYRTLKPEMDGL CCCCCCCCCCCCEEEEEECCCHHHHHHHHHCCCCCCEEEECCCCCCCCEEEECCCCCCH FCEKIFGPSKDWECHCGKYKRVRHRGIVCERCGVEVTESRVRRHRMGYIKLAAPVSHVWY HHHHHCCCCCCCCCCCCHHHHHHHCCCCHHHCCCHHHHHHHHHHHCCEEEEECCHHHHHH LKGIPSYVAILLDIPLRDVEQIVYFNCYVVLDVGDHKDLKYKQLLTEDEWLEIEDEIYAE HCCHHHHHHHHHHCCHHHHHHEEEEEEEEEEECCCCCCCHHHHHCCCCCCEEECHHHCCC DSTIENEPFVGIGAEALKQLLEDLDLNQIAEELREEITNSKGQKRAKLIKRIRVIDNFIA CCCCCCCCCCCCCHHHHHHHHHHCCHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHH TNAKPEWMVLDAIPVIPPDLRPMVQLDGGRFATSDLNDLYRRVINRNNRLARLQEILAPE CCCCCCEEEEECCCCCCCCCCCEEEECCCEEECCHHHHHHHHHHCCCCHHHHHHHHHCCH IIVRNEKRMLQEAVDALIDNGRRGRTVVGANNRALKSLSDIIEGKQGRFRQNLLGKRVDY HEECCHHHHHHHHHHHHHHCCCCCCEEECCCCHHHHHHHHHHCCCCCHHHHHHHCCCCCC SGRSVIVVGPKLKMHQCGLPKEMAIELFQPFVIHRLIRQNIVNNIKAAKKLIQKADDEVM CCCEEEEECCCCCHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHH QVLQEVIEGHPILLNRAPTLHRLGIQAFEPKLVGGRAIQLHPLVCPAFNADFDGDQMAVH HHHHHHHCCCCEEEECCCCHHHHCCHHCCCEEECCEEEEEECEECCCCCCCCCCCCEEEE VPLALEAQTEARMLMLASNNILSPATGEPIVTPSQDMVLGSYYLTALQPNFKKPNFGDNQ EEEEEECCCCCEEEEEECCCCCCCCCCCCCCCCCCCCEEHHHHHEEECCCCCCCCCCCCC RTYASLEDVIFAFEDKRVGLHEWVWLRFNGEVDDDEESKTPQETKELEDGSKLEIWNFRR HHHHHHHHHHEEECCCCCCCEEEEEEEECCCCCCCCCCCCCHHHHHCCCCCEEEEEECHH DRFDSQNNLISRFILTTVGRVVMNHTIIDSVSKT HHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: NA