| Definition | Azorhizobium caulinodans ORS 571, complete genome. |
|---|---|
| Accession | NC_009937 |
| Length | 5,369,772 |
Click here to switch to the map view.
The map label for this gene is pyrC [H]
Identifier: 158423238
GI number: 158423238
Start: 1843917
End: 1845272
Strand: Reverse
Name: pyrC [H]
Synonym: AZC_1614
Alternate gene names: 158423238
Gene position: 1845272-1843917 (Counterclockwise)
Preceding gene: 158423241
Following gene: 158423236
Centisome position: 34.36
GC content: 69.1
Gene sequence:
>1356_bases GTGGCCACGGGACGGCCGGGCCGCCGCCGGCGCGCGCCGAGCGGGGGCAGCGGGTATCCGCGCGCATTTCCGCGCTGCCG CCATGGACGAAGCGAGGACGGACCAGCTAACACAGGCGCGCGCCCGCGCAGCCCCTTGCCGGGCAGCTGCGGGGCGGCGC TGCCTTGGCGGCACAGCCGCCGATCGACATGCCGCAGCACGCCCGCCGCCGTCCTTACGGCATCGGCGGCCGGGCCTGCG GACCGTGACGGCCAGGGCGCGCGAGACTGGACTTCAGCCCGAAGCATGGGGCTGTTTCGGAGGATGGGTGACGTGGCGAG CTTGACGATCCGGCGGCCAGACGACTGGCATGTCCATTTCCGCGACGGTGCGGTGCTGAAGGAGGTTGTGCCCTTCACCG CCCGGCAGTTCGGGCGAGCCATCGTGATGCCGAACCTGACGCCGCCGGTGGTGACGACCGCCATGGCCGCCGCCTATCGC GAGCGCATCCGCGCCGCCATTCCCGCCGGCGTCGATTTCACGCCGCTGATGACCGTCTATCTCACCGACGGCACCGATCC GAAGGATCTCATCGCCGGCCACAGCGACGGCGTGCTCACCGCCGCCAAGCTCTATCCGGCGCACGCCACCACCAACTCGG CCCACGGCGTCTCCGAGATCGCCCGCATCGAGCAGGTACTGGCGGCGATGGAAGAGGCGGGCATGCCGCTGCTCGTCCAT GGCGAGCTGCCACGCGAGCATATCGACATCTTCGACCGCGAGCGCGCGTTCATCGATGCGGTGCTGGAGCCCATGCTCGC CAAGTTCCCGCGCCTCAAGGTGGTGATGGAGCACATCACCACGGCGGAGGGCGTTGCCCTCGTGCGCCGGCACCGGAGCC ATGTGGGCGGCACCATCACGCCCCAGCACCTGCTCTATAACCGCAACGCGCTGTTCCAGGGTGGCGTGCGGCCGCACATG TACTGCCTGCCGATCCTCAAGCGCGAGCAGCACCGGCTTGCGCTCCGTCAGGCGGCGACCAGCGGGGAAGCGAATTTCTT CCTCGGCACCGACACCGCGCCGCATATGCGCCACCTGAAGGAAAATGCCTGCGGCTGCGCCGGCGTTTTCAGCGCGCCTG TCGCGCTTCAAGCCTATCTGAAGGTGTTCGCCGAGGAAGGCGCGCTGGACAAGTTCGAGGCCTTCGCCTCCCTCAACGGC CCGGCCTTCTACGGCCTCAAGCCCAATGAAGCGCGCATCACCATCACCGACACGCTCTCCCCCACCTGCGAGGCGGTGAA CATCCCCGGCGAGGGCGAACTCATCCCCCTGTTCCATGGCGAACAGGTGCCGTGGTCGCAGATCGAGTCGGCCTGA
Upstream 100 bases:
>100_bases GTGCACCTTATGGCCATGGGGCCGGCCGCGTCATGGCGACCACTGACCGCCATATAAGACGCCGCCGCGCCAGCGTAAAC TCCGGACCGCGCGATAAGCT
Downstream 100 bases:
>100_bases TCCCGATCGCAAGCCGGGCGCCTCGCGGGGCGTCCGGCTTGCGACGCCAGTTCGCCCGTCAGGTCAGCGCCTCGCCCCGG CGCTCCGGCACCAGAAACAC
Product: dihydroorotase
Products: NA
Alternate protein names: DHOase [H]
Number of amino acids: Translated: 451; Mature: 450
Protein sequence:
>451_residues MATGRPGRRRRAPSGGSGYPRAFPRCRHGRSEDGPANTGARPRSPLPGSCGAALPWRHSRRSTCRSTPAAVLTASAAGPA DRDGQGARDWTSARSMGLFRRMGDVASLTIRRPDDWHVHFRDGAVLKEVVPFTARQFGRAIVMPNLTPPVVTTAMAAAYR ERIRAAIPAGVDFTPLMTVYLTDGTDPKDLIAGHSDGVLTAAKLYPAHATTNSAHGVSEIARIEQVLAAMEEAGMPLLVH GELPREHIDIFDRERAFIDAVLEPMLAKFPRLKVVMEHITTAEGVALVRRHRSHVGGTITPQHLLYNRNALFQGGVRPHM YCLPILKREQHRLALRQAATSGEANFFLGTDTAPHMRHLKENACGCAGVFSAPVALQAYLKVFAEEGALDKFEAFASLNG PAFYGLKPNEARITITDTLSPTCEAVNIPGEGELIPLFHGEQVPWSQIESA
Sequences:
>Translated_451_residues MATGRPGRRRRAPSGGSGYPRAFPRCRHGRSEDGPANTGARPRSPLPGSCGAALPWRHSRRSTCRSTPAAVLTASAAGPA DRDGQGARDWTSARSMGLFRRMGDVASLTIRRPDDWHVHFRDGAVLKEVVPFTARQFGRAIVMPNLTPPVVTTAMAAAYR ERIRAAIPAGVDFTPLMTVYLTDGTDPKDLIAGHSDGVLTAAKLYPAHATTNSAHGVSEIARIEQVLAAMEEAGMPLLVH GELPREHIDIFDRERAFIDAVLEPMLAKFPRLKVVMEHITTAEGVALVRRHRSHVGGTITPQHLLYNRNALFQGGVRPHM YCLPILKREQHRLALRQAATSGEANFFLGTDTAPHMRHLKENACGCAGVFSAPVALQAYLKVFAEEGALDKFEAFASLNG PAFYGLKPNEARITITDTLSPTCEAVNIPGEGELIPLFHGEQVPWSQIESA >Mature_450_residues ATGRPGRRRRAPSGGSGYPRAFPRCRHGRSEDGPANTGARPRSPLPGSCGAALPWRHSRRSTCRSTPAAVLTASAAGPAD RDGQGARDWTSARSMGLFRRMGDVASLTIRRPDDWHVHFRDGAVLKEVVPFTARQFGRAIVMPNLTPPVVTTAMAAAYRE RIRAAIPAGVDFTPLMTVYLTDGTDPKDLIAGHSDGVLTAAKLYPAHATTNSAHGVSEIARIEQVLAAMEEAGMPLLVHG ELPREHIDIFDRERAFIDAVLEPMLAKFPRLKVVMEHITTAEGVALVRRHRSHVGGTITPQHLLYNRNALFQGGVRPHMY CLPILKREQHRLALRQAATSGEANFFLGTDTAPHMRHLKENACGCAGVFSAPVALQAYLKVFAEEGALDKFEAFASLNGP AFYGLKPNEARITITDTLSPTCEAVNIPGEGELIPLFHGEQVPWSQIESA
Specific function: Pyrimidine biosynthesis; third step. [C]
COG id: COG0418
COG function: function code F; Dihydroorotase
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the DHOase family. Type 1 subfamily [H]
Homologues:
Organism=Escherichia coli, GI1787301, Length=339, Percent_Identity=56.9321533923304, Blast_Score=394, Evalue=1e-111, Organism=Saccharomyces cerevisiae, GI6323452, Length=355, Percent_Identity=30.9859154929577, Blast_Score=154, Evalue=2e-38,
Paralogues:
None
Copy number: 340 Molecules/Cell In: Growth Phase, Minimal Media (Based on E. coli). [C]
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR006680 - InterPro: IPR004721 - InterPro: IPR002195 [H]
Pfam domain/function: PF01979 Amidohydro_1 [H]
EC number: =3.5.2.3 [H]
Molecular weight: Translated: 48955; Mature: 48823
Theoretical pI: Translated: 9.44; Mature: 9.44
Prosite motif: PS00482 DIHYDROOROTASE_1 ; PS00483 DIHYDROOROTASE_2
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.6 %Cys (Translated Protein) 2.7 %Met (Translated Protein) 4.2 %Cys+Met (Translated Protein) 1.6 %Cys (Mature Protein) 2.4 %Met (Mature Protein) 4.0 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MATGRPGRRRRAPSGGSGYPRAFPRCRHGRSEDGPANTGARPRSPLPGSCGAALPWRHSR CCCCCCCCCCCCCCCCCCCCCCCHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCH RSTCRSTPAAVLTASAAGPADRDGQGARDWTSARSMGLFRRMGDVASLTIRRPDDWHVHF HHHHHCCCCCEEEECCCCCCCCCCCCCHHHHHHHHHHHHHHHCCHHEEEEECCCCCEEEE RDGAVLKEVVPFTARQFGRAIVMPNLTPPVVTTAMAAAYRERIRAAIPAGVDFTPLMTVY ECCHHHHHHHHHHHHHHCCEEECCCCCCHHHHHHHHHHHHHHHHHHCCCCCCCCEEEEEE LTDGTDPKDLIAGHSDGVLTAAKLYPAHATTNSAHGVSEIARIEQVLAAMEEAGMPLLVH EECCCCHHHHHCCCCCCCEEEEEEECCCCCCCCCCCHHHHHHHHHHHHHHHHCCCCEEEE GELPREHIDIFDRERAFIDAVLEPMLAKFPRLKVVMEHITTAEGVALVRRHRSHVGGTIT CCCCHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCCC PQHLLYNRNALFQGGVRPHMYCLPILKREQHRLALRQAATSGEANFFLGTDTAPHMRHLK HHHHHCCCCCCCCCCCCCCEEEHHHHHHHHHHHHHHHHHCCCCCEEEEECCCCHHHHHHH ENACGCAGVFSAPVALQAYLKVFAEEGALDKFEAFASLNGPAFYGLKPNEARITITDTLS HHCCCCHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHCCCCCEEECCCCCCCEEEEECCCC PTCEAVNIPGEGELIPLFHGEQVPWSQIESA CCCCEEECCCCCCEEEEECCCCCCHHHHCCC >Mature Secondary Structure ATGRPGRRRRAPSGGSGYPRAFPRCRHGRSEDGPANTGARPRSPLPGSCGAALPWRHSR CCCCCCCCCCCCCCCCCCCCCCHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCH RSTCRSTPAAVLTASAAGPADRDGQGARDWTSARSMGLFRRMGDVASLTIRRPDDWHVHF HHHHHCCCCCEEEECCCCCCCCCCCCCHHHHHHHHHHHHHHHCCHHEEEEECCCCCEEEE RDGAVLKEVVPFTARQFGRAIVMPNLTPPVVTTAMAAAYRERIRAAIPAGVDFTPLMTVY ECCHHHHHHHHHHHHHHCCEEECCCCCCHHHHHHHHHHHHHHHHHHCCCCCCCCEEEEEE LTDGTDPKDLIAGHSDGVLTAAKLYPAHATTNSAHGVSEIARIEQVLAAMEEAGMPLLVH EECCCCHHHHHCCCCCCCEEEEEEECCCCCCCCCCCHHHHHHHHHHHHHHHHCCCCEEEE GELPREHIDIFDRERAFIDAVLEPMLAKFPRLKVVMEHITTAEGVALVRRHRSHVGGTIT CCCCHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHCCCCCC PQHLLYNRNALFQGGVRPHMYCLPILKREQHRLALRQAATSGEANFFLGTDTAPHMRHLK HHHHHCCCCCCCCCCCCCCEEEHHHHHHHHHHHHHHHHHCCCCCEEEEECCCCHHHHHHH ENACGCAGVFSAPVALQAYLKVFAEEGALDKFEAFASLNGPAFYGLKPNEARITITDTLS HHCCCCHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHCCCCCEEECCCCCCCEEEEECCCC PTCEAVNIPGEGELIPLFHGEQVPWSQIESA CCCCEEECCCCCCEEEEECCCCCCHHHHCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: NA