| Definition | Prochlorococcus marinus str. AS9601, complete genome. |
|---|---|
| Accession | NC_008816 |
| Length | 1,669,886 |
Click here to switch to the map view.
The map label for this gene is dus1 [H]
Identifier: 123968631
GI number: 123968631
Start: 938171
End: 939178
Strand: Direct
Name: dus1 [H]
Synonym: A9601_10981
Alternate gene names: 123968631
Gene position: 938171-939178 (Clockwise)
Preceding gene: 123968628
Following gene: 123968632
Centisome position: 56.18
GC content: 32.94
Gene sequence:
>1008_bases ATGTCTTCAAATATAAGGCTAAAAGGAAGGGGAGTTAACAGAAAAATTACGAGTAAGGTAATGCTATCGCCATTAGCAGG AGTTACGGATAACATTTTTAGACGACTTGTACGTAAATGGGCTCCAAACTCTTTACTTTTTACAGAAATGATAAATGCCA CAAGTCTTAAAAAAGGATATGGCACACAAAAAATCAATCAAATAGATTTAGAAGAAGGTCCAATTGGAGTACAAATATTT GATAATAGGCCATATGCTGTTTCTGAAGCTGCAAAACAAGCTGAGGACTCTGGAGCTTTCTTAATCGATATAAATATGGG ATGTCCAGTAAAAAAAATTGCAAAGAAAGGTGGAGGCAGTGCCTTAATTAAAGACCGAAAACTTGCTATAGAATTAGTCA AAAATGTTGTAAAAGCTGTTAGGGTTCCTGTAACAGTAAAAACACGACTCGGATGGGATAGTAAAGAAGAAAATATAGAG GATTTCTTATTTAAACTTCAAGATGCGGGAGCAACCATGATCACACTTCATGGAAGAACTAGAAAACAGGGTTTTTCAGG CAAGTCAGATTGGGAAATGATCGGGAGACTTAAAAAGTTGTTGGAAATTCCAGTAATTGCTAATGGAGATATCAAAAATC CAGATGACGCTCTTAATTGTTTGAAAAAAACAAAAGCTGATGGTGTAATGATTGGACGAGGAATTTTAGGATCCCCATGG AAAATAGGAGAAATAGATTATGCTCTTAGAGAAAATAAAAATTTTAAAGAACCAAACACAGAAGAAAAACTATATTTAAT TATTGAGCATCTTGATGAATTAATAAAAGAAAAAGGAGATCACGGTTTGCTAATCGCAAGGAAACATATCTCATGGACAT GCAAAGACTTTAAAGGGGCATCAAATTTGAGAAATAACTTGGTTAGAGCTGTTGATAAAAATGAAGTTAAAAATTTAATA AATAAAATGATTCAAACTTTGAATAATGAAAAAAATAGATTAGCTTAA
Upstream 100 bases:
>100_bases GTAAAAGCACTTAGTATAAATTAAGAAATAAATAGAAAACGTAAGATCATCTCCCTATCTGAATTTATAATAAATAAAGA TTAAATAAATTTAAAATTAT
Downstream 100 bases:
>100_bases AACAAATTTATTTTTTAAATGAAAATTATTAGTAAAGAAACAAGTAAAAGAGTTTGTGATCACATGAATAATGATCACAT AGATTCAGTACACAAATATC
Product: nitrogen regulation protein NifR3 family-like protein
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 335; Mature: 334
Protein sequence:
>335_residues MSSNIRLKGRGVNRKITSKVMLSPLAGVTDNIFRRLVRKWAPNSLLFTEMINATSLKKGYGTQKINQIDLEEGPIGVQIF DNRPYAVSEAAKQAEDSGAFLIDINMGCPVKKIAKKGGGSALIKDRKLAIELVKNVVKAVRVPVTVKTRLGWDSKEENIE DFLFKLQDAGATMITLHGRTRKQGFSGKSDWEMIGRLKKLLEIPVIANGDIKNPDDALNCLKKTKADGVMIGRGILGSPW KIGEIDYALRENKNFKEPNTEEKLYLIIEHLDELIKEKGDHGLLIARKHISWTCKDFKGASNLRNNLVRAVDKNEVKNLI NKMIQTLNNEKNRLA
Sequences:
>Translated_335_residues MSSNIRLKGRGVNRKITSKVMLSPLAGVTDNIFRRLVRKWAPNSLLFTEMINATSLKKGYGTQKINQIDLEEGPIGVQIF DNRPYAVSEAAKQAEDSGAFLIDINMGCPVKKIAKKGGGSALIKDRKLAIELVKNVVKAVRVPVTVKTRLGWDSKEENIE DFLFKLQDAGATMITLHGRTRKQGFSGKSDWEMIGRLKKLLEIPVIANGDIKNPDDALNCLKKTKADGVMIGRGILGSPW KIGEIDYALRENKNFKEPNTEEKLYLIIEHLDELIKEKGDHGLLIARKHISWTCKDFKGASNLRNNLVRAVDKNEVKNLI NKMIQTLNNEKNRLA >Mature_334_residues SSNIRLKGRGVNRKITSKVMLSPLAGVTDNIFRRLVRKWAPNSLLFTEMINATSLKKGYGTQKINQIDLEEGPIGVQIFD NRPYAVSEAAKQAEDSGAFLIDINMGCPVKKIAKKGGGSALIKDRKLAIELVKNVVKAVRVPVTVKTRLGWDSKEENIED FLFKLQDAGATMITLHGRTRKQGFSGKSDWEMIGRLKKLLEIPVIANGDIKNPDDALNCLKKTKADGVMIGRGILGSPWK IGEIDYALRENKNFKEPNTEEKLYLIIEHLDELIKEKGDHGLLIARKHISWTCKDFKGASNLRNNLVRAVDKNEVKNLIN KMIQTLNNEKNRLA
Specific function: Catalyzes the synthesis of dihydrouridine, a modified base found in the D-loop of most tRNAs [H]
COG id: COG0042
COG function: function code J; tRNA-dihydrouridine synthase
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the dus family [H]
Homologues:
Organism=Homo sapiens, GI239788483, Length=236, Percent_Identity=31.7796610169492, Blast_Score=112, Evalue=4e-25, Organism=Homo sapiens, GI239788462, Length=236, Percent_Identity=31.7796610169492, Blast_Score=110, Evalue=1e-24, Organism=Homo sapiens, GI40807366, Length=228, Percent_Identity=31.140350877193, Blast_Score=101, Evalue=1e-21, Organism=Homo sapiens, GI31742496, Length=226, Percent_Identity=34.070796460177, Blast_Score=100, Evalue=3e-21, Organism=Homo sapiens, GI8923374, Length=142, Percent_Identity=33.0985915492958, Blast_Score=74, Evalue=2e-13, Organism=Escherichia coli, GI1789660, Length=303, Percent_Identity=34.6534653465347, Blast_Score=175, Evalue=4e-45, Organism=Escherichia coli, GI1788462, Length=328, Percent_Identity=32.0121951219512, Blast_Score=144, Evalue=1e-35, Organism=Escherichia coli, GI145693211, Length=307, Percent_Identity=26.3843648208469, Blast_Score=98, Evalue=6e-22, Organism=Caenorhabditis elegans, GI17507177, Length=264, Percent_Identity=33.3333333333333, Blast_Score=112, Evalue=3e-25, Organism=Caenorhabditis elegans, GI25144369, Length=212, Percent_Identity=31.6037735849057, Blast_Score=96, Evalue=3e-20, Organism=Caenorhabditis elegans, GI17543114, Length=237, Percent_Identity=29.1139240506329, Blast_Score=87, Evalue=2e-17, Organism=Saccharomyces cerevisiae, GI6323560, Length=244, Percent_Identity=32.7868852459016, Blast_Score=100, Evalue=2e-22, Organism=Saccharomyces cerevisiae, GI6323433, Length=304, Percent_Identity=25.3289473684211, Blast_Score=87, Evalue=3e-18, Organism=Saccharomyces cerevisiae, GI6323437, Length=226, Percent_Identity=29.646017699115, Blast_Score=79, Evalue=1e-15, Organism=Drosophila melanogaster, GI24585320, Length=249, Percent_Identity=33.7349397590361, Blast_Score=119, Evalue=2e-27, Organism=Drosophila melanogaster, GI24580595, Length=227, Percent_Identity=30.8370044052863, Blast_Score=106, Evalue=2e-23, Organism=Drosophila melanogaster, GI19920448, Length=227, Percent_Identity=30.8370044052863, Blast_Score=106, Evalue=2e-23, Organism=Drosophila melanogaster, GI19921524, Length=235, Percent_Identity=32.7659574468085, Blast_Score=91, Evalue=9e-19, Organism=Drosophila melanogaster, GI45549423, Length=136, Percent_Identity=33.8235294117647, Blast_Score=74, Evalue=2e-13,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR013785 - InterPro: IPR004652 - InterPro: IPR001269 - InterPro: IPR018517 [H]
Pfam domain/function: PF01207 Dus [H]
EC number: NA
Molecular weight: Translated: 37499; Mature: 37368
Theoretical pI: Translated: 10.44; Mature: 10.44
Prosite motif: PS01136 UPF0034
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.9 %Cys (Translated Protein) 2.4 %Met (Translated Protein) 3.3 %Cys+Met (Translated Protein) 0.9 %Cys (Mature Protein) 2.1 %Met (Mature Protein) 3.0 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MSSNIRLKGRGVNRKITSKVMLSPLAGVTDNIFRRLVRKWAPNSLLFTEMINATSLKKGY CCCCEEEECCCCCHHHHHHHHHHHHCCHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHCCC GTQKINQIDLEEGPIGVQIFDNRPYAVSEAAKQAEDSGAFLIDINMGCPVKKIAKKGGGS CCCCCCEEECCCCCEEEEEECCCCCHHHHHHHHHCCCCCEEEEECCCCCHHHHHHCCCCC ALIKDRKLAIELVKNVVKAVRVPVTVKTRLGWDSKEENIEDFLFKLQDAGATMITLHGRT EEHHHHHHHHHHHHHHHHHHHCCEEEEECCCCCCCCCCHHHHHHHHHCCCCEEEEECCCH RKQGFSGKSDWEMIGRLKKLLEIPVIANGDIKNPDDALNCLKKTKADGVMIGRGILGSPW HCCCCCCCCHHHHHHHHHHHHHCCCEECCCCCCHHHHHHHHHHCCCCCEEEECCCCCCCE KIGEIDYALRENKNFKEPNTEEKLYLIIEHLDELIKEKGDHGLLIARKHISWTCKDFKGA ECCCCHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHCCCCCCEEEEECCCCEEEHHHCCH SNLRNNLVRAVDKNEVKNLINKMIQTLNNEKNRLA HHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCC >Mature Secondary Structure SSNIRLKGRGVNRKITSKVMLSPLAGVTDNIFRRLVRKWAPNSLLFTEMINATSLKKGY CCCEEEECCCCCHHHHHHHHHHHHCCHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHCCC GTQKINQIDLEEGPIGVQIFDNRPYAVSEAAKQAEDSGAFLIDINMGCPVKKIAKKGGGS CCCCCCEEECCCCCEEEEEECCCCCHHHHHHHHHCCCCCEEEEECCCCCHHHHHHCCCCC ALIKDRKLAIELVKNVVKAVRVPVTVKTRLGWDSKEENIEDFLFKLQDAGATMITLHGRT EEHHHHHHHHHHHHHHHHHHHCCEEEEECCCCCCCCCCHHHHHHHHHCCCCEEEEECCCH RKQGFSGKSDWEMIGRLKKLLEIPVIANGDIKNPDDALNCLKKTKADGVMIGRGILGSPW HCCCCCCCCHHHHHHHHHHHHHCCCEECCCCCCHHHHHHHHHHCCCCCEEEECCCCCCCE KIGEIDYALRENKNFKEPNTEEKLYLIIEHLDELIKEKGDHGLLIARKHISWTCKDFKGA ECCCCHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHCCCCCCEEEEECCCCEEEHHHCCH SNLRNNLVRAVDKNEVKNLINKMIQTLNNEKNRLA HHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 10.0
TargetDB status: NA
Availability: NA
References: 8590279; 8905231 [H]