| Definition | Synechococcus sp. PCC 7002 chromosome, complete genome. |
|---|---|
| Accession | NC_010475 |
| Length | 3,008,047 |
Click here to switch to the map view.
The map label for this gene is dus1 [H]
Identifier: 170077562
GI number: 170077562
Start: 971122
End: 972183
Strand: Direct
Name: dus1 [H]
Synonym: SYNPCC7002_A0940
Alternate gene names: 170077562
Gene position: 971122-972183 (Clockwise)
Preceding gene: 170077561
Following gene: 170077564
Centisome position: 32.28
GC content: 55.37
Gene sequence:
>1062_bases GTGAATTCTGACCCAAGGCGATCGCCGCCAATCTCCCTGCCAGATAGCCCCTTAAAAATTGGTAACGTTGCCCTCCAGAG CCGTGTCCTCCAAGCGCCCCTATCGGGGGTCACGGATCTAGTATTTCGTCGCCTGGTACGTCGCTACGCCCCCAGTTCAA TGATGTACACCGAAATGGTGCGCGCCCAGGAAGTTCACCACCTCCAGACCTTACCGAGGCTCATGGAGATTGACCCGGGG GAGCAGCCGATCAGCATTCAACTGTTTGACTGTCGCCCTGATTTTATGGGGGAAGCAGCAAAAAAAGCCGTGGCCGAGGG CGCCCAAACCATCGACATCAACATGGGTTGTCCGGTGAATAAAATTACCCGCAAAGGAGGTGGTAGCTCCCTCCTGCGGC AACCAGAGGTGGCGGTGGCGATCGTTAAAGCAGTGGTGGAAGCCGTCGATGTGCCTGTGACCGTTAAAACCCGCATTGGT TGGGCTGATGCTGAAATCGTGATTGTTGACTTTGCCCGCCGGTTAGAAGATGCCGGAGCGCAAATGCTGACGGTGCACGG TCGCACCCGGGCCCAGGGTTACACCGGGAAAGCCCAGTGGCAGTGGATTAAAAAAGTCAAAGAAGTCCTCTCGATTCCGG TGATTGCCAACGGCGATATTTTTTCCGTGGATGCGGCGATCGCCTGCCTGGAAGCAACGGGAGCTGATGGGGTGATGTGT TCCCGGGGTACCCTTGGTTATCCGTTTTTAGTCGGCGAAATTGACCATTTCCTCAAAACGGGACAGCGGCGGCCCCAACC AACCGTGGTGGAGTTGCTCCAGTGCGCCAAGGAACATTTAGACGGGCTCTGGGCCTACAAAGGACAAAAGGGCATTTACC AATCCCGCAAGCACCTGACTTGGTATTGTCGCGATTTTCCGGGGGCCGCAGATTTTCGCGATCGCCTTAATAAAATCAAC ACCGTCGCCGAAGGTCAAGCCCTCCTGGATGAAGCCATTGAGCAAGTACAAAACCAAGCCAGCATTCCCGCCATCCAAAC ACCCCAATTGGCGGTGATTTAA
Upstream 100 bases:
>100_bases CCAGAACTAGAACAGCTACTCTTGTCCAAGACAATATTTCCCCATGATTCGGTAATCTTTGATGCCCCTGACCCCTAACA CCACGGCCCCAGTAAATTCA
Downstream 100 bases:
>100_bases CCCTTTTTGAGTTTACGAAACACCTCGTACATTTCCGGTAAACGCTTGTAGATGGCCGAAACTTTCCGGTAAACCGCATT GGGCACCGCTGGACTACCAG
Product: dihydrouridine synthase (Dus)
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 353; Mature: 353
Protein sequence:
>353_residues MNSDPRRSPPISLPDSPLKIGNVALQSRVLQAPLSGVTDLVFRRLVRRYAPSSMMYTEMVRAQEVHHLQTLPRLMEIDPG EQPISIQLFDCRPDFMGEAAKKAVAEGAQTIDINMGCPVNKITRKGGGSSLLRQPEVAVAIVKAVVEAVDVPVTVKTRIG WADAEIVIVDFARRLEDAGAQMLTVHGRTRAQGYTGKAQWQWIKKVKEVLSIPVIANGDIFSVDAAIACLEATGADGVMC SRGTLGYPFLVGEIDHFLKTGQRRPQPTVVELLQCAKEHLDGLWAYKGQKGIYQSRKHLTWYCRDFPGAADFRDRLNKIN TVAEGQALLDEAIEQVQNQASIPAIQTPQLAVI
Sequences:
>Translated_353_residues MNSDPRRSPPISLPDSPLKIGNVALQSRVLQAPLSGVTDLVFRRLVRRYAPSSMMYTEMVRAQEVHHLQTLPRLMEIDPG EQPISIQLFDCRPDFMGEAAKKAVAEGAQTIDINMGCPVNKITRKGGGSSLLRQPEVAVAIVKAVVEAVDVPVTVKTRIG WADAEIVIVDFARRLEDAGAQMLTVHGRTRAQGYTGKAQWQWIKKVKEVLSIPVIANGDIFSVDAAIACLEATGADGVMC SRGTLGYPFLVGEIDHFLKTGQRRPQPTVVELLQCAKEHLDGLWAYKGQKGIYQSRKHLTWYCRDFPGAADFRDRLNKIN TVAEGQALLDEAIEQVQNQASIPAIQTPQLAVI >Mature_353_residues MNSDPRRSPPISLPDSPLKIGNVALQSRVLQAPLSGVTDLVFRRLVRRYAPSSMMYTEMVRAQEVHHLQTLPRLMEIDPG EQPISIQLFDCRPDFMGEAAKKAVAEGAQTIDINMGCPVNKITRKGGGSSLLRQPEVAVAIVKAVVEAVDVPVTVKTRIG WADAEIVIVDFARRLEDAGAQMLTVHGRTRAQGYTGKAQWQWIKKVKEVLSIPVIANGDIFSVDAAIACLEATGADGVMC SRGTLGYPFLVGEIDHFLKTGQRRPQPTVVELLQCAKEHLDGLWAYKGQKGIYQSRKHLTWYCRDFPGAADFRDRLNKIN TVAEGQALLDEAIEQVQNQASIPAIQTPQLAVI
Specific function: Catalyzes the synthesis of dihydrouridine, a modified base found in the D-loop of most tRNAs [H]
COG id: COG0042
COG function: function code J; tRNA-dihydrouridine synthase
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the dus family [H]
Homologues:
Organism=Homo sapiens, GI239788462, Length=300, Percent_Identity=29, Blast_Score=117, Evalue=2e-26, Organism=Homo sapiens, GI239788483, Length=296, Percent_Identity=30.0675675675676, Blast_Score=117, Evalue=2e-26, Organism=Homo sapiens, GI31742496, Length=225, Percent_Identity=35.5555555555556, Blast_Score=112, Evalue=5e-25, Organism=Homo sapiens, GI40807366, Length=277, Percent_Identity=32.129963898917, Blast_Score=111, Evalue=8e-25, Organism=Homo sapiens, GI8923374, Length=169, Percent_Identity=32.5443786982249, Blast_Score=77, Evalue=3e-14, Organism=Escherichia coli, GI1789660, Length=322, Percent_Identity=38.8198757763975, Blast_Score=209, Evalue=3e-55, Organism=Escherichia coli, GI1788462, Length=258, Percent_Identity=37.2093023255814, Blast_Score=147, Evalue=7e-37, Organism=Escherichia coli, GI145693211, Length=246, Percent_Identity=27.6422764227642, Blast_Score=85, Evalue=7e-18, Organism=Caenorhabditis elegans, GI25144369, Length=264, Percent_Identity=32.1969696969697, Blast_Score=108, Evalue=4e-24, Organism=Caenorhabditis elegans, GI17507177, Length=316, Percent_Identity=28.1645569620253, Blast_Score=105, Evalue=3e-23, Organism=Caenorhabditis elegans, GI17543114, Length=247, Percent_Identity=29.1497975708502, Blast_Score=98, Evalue=6e-21, Organism=Saccharomyces cerevisiae, GI6323560, Length=318, Percent_Identity=30.188679245283, Blast_Score=108, Evalue=1e-24, Organism=Saccharomyces cerevisiae, GI6323437, Length=226, Percent_Identity=30.5309734513274, Blast_Score=94, Evalue=4e-20, Organism=Saccharomyces cerevisiae, GI6323433, Length=316, Percent_Identity=25.3164556962025, Blast_Score=86, Evalue=9e-18, Organism=Drosophila melanogaster, GI24580595, Length=233, Percent_Identity=36.0515021459227, Blast_Score=125, Evalue=5e-29, Organism=Drosophila melanogaster, GI19920448, Length=233, Percent_Identity=36.0515021459227, Blast_Score=125, Evalue=5e-29, Organism=Drosophila melanogaster, GI19921524, Length=303, Percent_Identity=30.3630363036304, Blast_Score=105, Evalue=5e-23, Organism=Drosophila melanogaster, GI24585320, Length=240, Percent_Identity=31.25, Blast_Score=104, Evalue=7e-23, Organism=Drosophila melanogaster, GI45549423, Length=148, Percent_Identity=32.4324324324324, Blast_Score=75, Evalue=1e-13,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR013785 - InterPro: IPR004652 - InterPro: IPR001269 - InterPro: IPR018517 [H]
Pfam domain/function: PF01207 Dus [H]
EC number: NA
Molecular weight: Translated: 38815; Mature: 38815
Theoretical pI: Translated: 8.36; Mature: 8.36
Prosite motif: PS01136 UPF0034
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.7 %Cys (Translated Protein) 2.5 %Met (Translated Protein) 4.2 %Cys+Met (Translated Protein) 1.7 %Cys (Mature Protein) 2.5 %Met (Mature Protein) 4.2 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MNSDPRRSPPISLPDSPLKIGNVALQSRVLQAPLSGVTDLVFRRLVRRYAPSSMMYTEMV CCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHH RAQEVHHLQTLPRLMEIDPGEQPISIQLFDCRPDFMGEAAKKAVAEGAQTIDINMGCPVN HHHHHHHHHHHHHHHCCCCCCCCEEEEEEECCCHHHHHHHHHHHHCCCCEEEEECCCCHH KITRKGGGSSLLRQPEVAVAIVKAVVEAVDVPVTVKTRIGWADAEIVIVDFARRLEDAGA HHHHCCCCHHHHCCCHHHHHHHHHHHHHHCCCEEEEEECCCCCCCEEEHHHHHHHHHCCC QMLTVHGRTRAQGYTGKAQWQWIKKVKEVLSIPVIANGDIFSVDAAIACLEATGADGVMC EEEEECCCCCCCCCCCHHHHHHHHHHHHHHHCCEEECCCEEEHHHHHHHHHCCCCCCEEE SRGTLGYPFLVGEIDHFLKTGQRRPQPTVVELLQCAKEHLDGLWAYKGQKGIYQSRKHLT CCCCCCCCHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHCCHHHCCCCCCHHHHHHCEE WYCRDFPGAADFRDRLNKINTVAEGQALLDEAIEQVQNQASIPAIQTPQLAVI EEEECCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCEECC >Mature Secondary Structure MNSDPRRSPPISLPDSPLKIGNVALQSRVLQAPLSGVTDLVFRRLVRRYAPSSMMYTEMV CCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHH RAQEVHHLQTLPRLMEIDPGEQPISIQLFDCRPDFMGEAAKKAVAEGAQTIDINMGCPVN HHHHHHHHHHHHHHHCCCCCCCCEEEEEEECCCHHHHHHHHHHHHCCCCEEEEECCCCHH KITRKGGGSSLLRQPEVAVAIVKAVVEAVDVPVTVKTRIGWADAEIVIVDFARRLEDAGA HHHHCCCCHHHHCCCHHHHHHHHHHHHHHCCCEEEEEECCCCCCCEEEHHHHHHHHHCCC QMLTVHGRTRAQGYTGKAQWQWIKKVKEVLSIPVIANGDIFSVDAAIACLEATGADGVMC EEEEECCCCCCCCCCCHHHHHHHHHHHHHHHCCEEECCCEEEHHHHHHHHHCCCCCCEEE SRGTLGYPFLVGEIDHFLKTGQRRPQPTVVELLQCAKEHLDGLWAYKGQKGIYQSRKHLT CCCCCCCCHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHCCHHHCCCCCCHHHHHHCEE WYCRDFPGAADFRDRLNKINTVAEGQALLDEAIEQVQNQASIPAIQTPQLAVI EEEECCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCEECC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 10.0
TargetDB status: NA
Availability: NA
References: 8590279; 8905231 [H]