| Definition | Prochlorococcus marinus str. MIT 9313 chromosome, complete genome. |
|---|---|
| Accession | NC_005071 |
| Length | 2,410,873 |
Click here to switch to the map view.
The map label for this gene is ispE [H]
Identifier: 33862893
GI number: 33862893
Start: 674112
End: 675071
Strand: Reverse
Name: ispE [H]
Synonym: PMT0620
Alternate gene names: 33862893
Gene position: 675071-674112 (Counterclockwise)
Preceding gene: 33862894
Following gene: 33862892
Centisome position: 28.0
GC content: 52.08
Gene sequence:
>960_bases ATGAGCATATCTAACCCTTCAGCTGCTTCAGAGCATCTGGTTAGCGTCTCGGCGCCAGCCAAGATCAATCTCCATCTTGA GGTGCTTGGCCTGAGGTCTGATGGTTTTCATGAGCTAGCGATGGTGATGCAGAGCATCGAACTCGCTGATCAACTTCATT TCCGCAATACGGCTGATGGCAGCATCAGCCTTCGCTGCGATGATTCCAGCCTCAGCACTGCTGGCGACAATTTGATCGTG CGAGCTGCGCATTTATTACGCGAGCGCTCAGGGTTCTCTGACCTTGGTGCCGCGATTGAATTGCAAAAACGCATCCCAAT TGGAGCTGGTCTTGCGGGCGGCTCAAGTGATGGTGCAGCAACACTGGTGGGGTTAAACGGTCTCTGGAATCTCAATTTTT CTCAGGGTCAACTTGAAGGTTTTGCGGCTGAGCTTGGCTCCGACATGCCCTTTTGCCTGGCAGGTGGAAGCCAATTGTGT TTCGGCCGTGGGGAAAGGTTGGAATCGCTACAAGCGATGAAAGCATCAATGGCCGTGGTGTTGGTGAAGGATCCATCAGT GAGCGTTTCAACCCCCTGGGCTTATGGACGCTGTAAGGAACTTTTCAGTAGTCGTTATCTTTCAAAGGAATCTGATTTTG AGCAACGTCGTCAGCAGCTCAGAGAATCTTCTTGGCTGAATCCTTTACGGGCTGATGATCCGCCACCTCTGCGCAACGAC CTTCAGGAGGTTGTTGCACCCGAAGTTTCGGCTGTGCAAACCACATTGAAGTTGCTCACTGATTTGCCTGGTTCTCTTGC AGTATCGATGAGTGGATCTGGTCCAAGCTGTTTTGCCCTTTTTGCTGACGTTGCTTCAGCTCAGGCTGCACTTCAGCTCC AACAGCCTGCCTTCGCCGCAGCTGGTTTAAGCAGTTGGTGCTGCGCGTTCCGCTGTGAAGGCATCAAACTGGAAGCATGA
Upstream 100 bases:
>100_bases TTGGCATCAGCCTTCAGCAACGCCCCCAAGAACTGTCCCCTGCCACTTGGGTGGAATTGGCGAGGGGTTTGAATCGGGCG GATCTAGTAGACCCTGAGCC
Downstream 100 bases:
>100_bases GCGATTCCAAAAACAGCTCTTTCGAGAAGGCAGATGCAGAGTCATCCAACACCTTGGCAGAGACGCCTGCGACACCACGT AAGGGCCCGCTCAGTTTTCT
Product: 4-diphosphocytidyl-2-C-methyl-D-erythritol kinase
Products: NA
Alternate protein names: CMK; 4-(cytidine-5'-diphospho)-2-C-methyl-D-erythritol kinase [H]
Number of amino acids: Translated: 319; Mature: 318
Protein sequence:
>319_residues MSISNPSAASEHLVSVSAPAKINLHLEVLGLRSDGFHELAMVMQSIELADQLHFRNTADGSISLRCDDSSLSTAGDNLIV RAAHLLRERSGFSDLGAAIELQKRIPIGAGLAGGSSDGAATLVGLNGLWNLNFSQGQLEGFAAELGSDMPFCLAGGSQLC FGRGERLESLQAMKASMAVVLVKDPSVSVSTPWAYGRCKELFSSRYLSKESDFEQRRQQLRESSWLNPLRADDPPPLRND LQEVVAPEVSAVQTTLKLLTDLPGSLAVSMSGSGPSCFALFADVASAQAALQLQQPAFAAAGLSSWCCAFRCEGIKLEA
Sequences:
>Translated_319_residues MSISNPSAASEHLVSVSAPAKINLHLEVLGLRSDGFHELAMVMQSIELADQLHFRNTADGSISLRCDDSSLSTAGDNLIV RAAHLLRERSGFSDLGAAIELQKRIPIGAGLAGGSSDGAATLVGLNGLWNLNFSQGQLEGFAAELGSDMPFCLAGGSQLC FGRGERLESLQAMKASMAVVLVKDPSVSVSTPWAYGRCKELFSSRYLSKESDFEQRRQQLRESSWLNPLRADDPPPLRND LQEVVAPEVSAVQTTLKLLTDLPGSLAVSMSGSGPSCFALFADVASAQAALQLQQPAFAAAGLSSWCCAFRCEGIKLEA >Mature_318_residues SISNPSAASEHLVSVSAPAKINLHLEVLGLRSDGFHELAMVMQSIELADQLHFRNTADGSISLRCDDSSLSTAGDNLIVR AAHLLRERSGFSDLGAAIELQKRIPIGAGLAGGSSDGAATLVGLNGLWNLNFSQGQLEGFAAELGSDMPFCLAGGSQLCF GRGERLESLQAMKASMAVVLVKDPSVSVSTPWAYGRCKELFSSRYLSKESDFEQRRQQLRESSWLNPLRADDPPPLRNDL QEVVAPEVSAVQTTLKLLTDLPGSLAVSMSGSGPSCFALFADVASAQAALQLQQPAFAAAGLSSWCCAFRCEGIKLEA
Specific function: Catalyzes the phosphorylation of the position 2 hydroxy group of 4-diphosphocytidyl-2C-methyl-D-erythritol [H]
COG id: COG1947
COG function: function code I; 4-diphosphocytidyl-2C-methyl-D-erythritol 2-phosphate synthase
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the GHMP kinase family. IspE subfamily [H]
Homologues:
Organism=Escherichia coli, GI1787459, Length=180, Percent_Identity=37.2222222222222, Blast_Score=92, Evalue=4e-20,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR006204 - InterPro: IPR013750 - InterPro: IPR004424 - InterPro: IPR020568 - InterPro: IPR014721 [H]
Pfam domain/function: PF08544 GHMP_kinases_C; PF00288 GHMP_kinases_N [H]
EC number: =2.7.1.148 [H]
Molecular weight: Translated: 33844; Mature: 33712
Theoretical pI: Translated: 4.88; Mature: 4.88
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
2.5 %Cys (Translated Protein) 2.2 %Met (Translated Protein) 4.7 %Cys+Met (Translated Protein) 2.5 %Cys (Mature Protein) 1.9 %Met (Mature Protein) 4.4 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MSISNPSAASEHLVSVSAPAKINLHLEVLGLRSDGFHELAMVMQSIELADQLHFRNTADG CCCCCCCCHHHHEEEECCCCEEEEEEEEEEECCCCHHHHHHHHHHHHHHHHHHCCCCCCC SISLRCDDSSLSTAGDNLIVRAAHLLRERSGFSDLGAAIELQKRIPIGAGLAGGSSDGAA EEEEEECCCCCCCCCCHHHHHHHHHHHHHCCCHHHHHHHHHHHCCCCCCCCCCCCCCCCE TLVGLNGLWNLNFSQGQLEGFAAELGSDMPFCLAGGSQLCFGRGERLESLQAMKASMAVV EEEECCCEEECCCCCCHHHHHHHHHCCCCCEEEECCCEEECCCCHHHHHHHHHHHCEEEE LVKDPSVSVSTPWAYGRCKELFSSRYLSKESDFEQRRQQLRESSWLNPLRADDPPPLRND EEECCCCCEECCCHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHCCCCCCCCCCCCHHHH LQEVVAPEVSAVQTTLKLLTDLPGSLAVSMSGSGPSCFALFADVASAQAALQLQQPAFAA HHHHHCCCHHHHHHHHHHHHCCCCCEEEEECCCCCHHHHHHHHHHHHHHHHHHCCCHHHH AGLSSWCCAFRCEGIKLEA HCHHHHHHHHEECCEEECC >Mature Secondary Structure SISNPSAASEHLVSVSAPAKINLHLEVLGLRSDGFHELAMVMQSIELADQLHFRNTADG CCCCCCCHHHHEEEECCCCEEEEEEEEEEECCCCHHHHHHHHHHHHHHHHHHCCCCCCC SISLRCDDSSLSTAGDNLIVRAAHLLRERSGFSDLGAAIELQKRIPIGAGLAGGSSDGAA EEEEEECCCCCCCCCCHHHHHHHHHHHHHCCCHHHHHHHHHHHCCCCCCCCCCCCCCCCE TLVGLNGLWNLNFSQGQLEGFAAELGSDMPFCLAGGSQLCFGRGERLESLQAMKASMAVV EEEECCCEEECCCCCCHHHHHHHHHCCCCCEEEECCCEEECCCCHHHHHHHHHHHCEEEE LVKDPSVSVSTPWAYGRCKELFSSRYLSKESDFEQRRQQLRESSWLNPLRADDPPPLRND EEECCCCCEECCCHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHCCCCCCCCCCCCHHHH LQEVVAPEVSAVQTTLKLLTDLPGSLAVSMSGSGPSCFALFADVASAQAALQLQQPAFAA HHHHHCCCHHHHHHHHHHHHCCCCCEEEEECCCCCHHHHHHHHHHHHHHHHHHCCCHHHH AGLSSWCCAFRCEGIKLEA HCHHHHHHHHEECCEEECC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 10.0
TargetDB status: NA
Availability: NA
References: NA