| Definition | Rhizobium leguminosarum bv. viciae 3841 plasmid pRL12, complete sequence. |
|---|---|
| Accession | NC_008378 |
| Length | 870,021 |
Click here to switch to the map view.
The map label for this gene is yagR [H]
Identifier: 116248969
GI number: 116248969
Start: 317349
End: 319547
Strand: Reverse
Name: yagR [H]
Synonym: pRL120300
Alternate gene names: 116248969
Gene position: 319547-317349 (Counterclockwise)
Preceding gene: 116248970
Following gene: 116248968
Centisome position: 36.73
GC content: 62.76
Gene sequence:
>2199_bases ATGCAGTTCGATACGCCAGCGACAACCAACCCGATCGACAATCTGAAGGTCGTCGGCCAGCCGATCCACCGCATCGATGG TCAGCTCAAGACGACCGGCCGCGCGATGTACGCCTATGAGTGGCACGATCCGAATATGTCCTACGCCTACGGTTATCCCG TTGGCGCGGCCATCGCCAAGGGCCGCATCACGTCCATGGACGTTTCCGCCGCCAAAAAGGCTCCGGGCGTGCTTGCCGTC GTGACGACGCTCGATATCGGCGAGCGGAAGAAGGGCAGGTTCAACACCGCCAAGCTTTTCGGTGGCGACGAGGTTCAGCA CTATCACCAGGCAATCGCGGTCGTCGTCGCCGAGACCTTCGAGCAGGCACGCGCCGCAGCCTCCCTGGTCAAGGTCGACT ATGCCGAAGAAAAGGGTGTGTTCGATCTCGGTCAGGCAAAGGATTCAGCCGTCAAGCCGGATGAATCTCAGCAGCCCGAT ACAGCGGTCGGCGACTTCGAGGCTGCCTTCAGGTCAGCTCCCGTCACTGTCGACGCGTCTTACACGACGCCCGACCAGTC GCATGCGATGATGGAGCCGCACGCATCGATCGCAGCCTGGAACGGCGACGAGGTGACCGTCTGGACCTCCAGCCAGATGA TCGACTGGTGGCGCTCCGACCTTGCAACGACGCTCGACATCGACAAGGAGAATATCCACCTCATGTCGCCGTTCATCGGC GGCGGCTTCGGCGGCAAGCTGTTCCTGCGGGCGGATGCCGTGCTGGCCGTTGTCGGTGCGCGTGCGGTCAAGCGGCCCGT CAAGGTCGCCTTGCCTCGCCCCCTCCTGATAAACAACACCACCCATCGGCCGGCGACGATCCAGCGGATCCGCATTGGAA CCGAGCGTGACGGCAAGATCACTGCCATTGCGCACGAAAGCTGGTCCGGCGACCTTCCGGGCGGCGGACTGGAGACCGCC GTCAACCAGACGCGGCTCCTCTATGCGGGTGCAAACCGGATGACCGCAATGCGTCTTGCGACGCTTCATCTCCCGGAGGG CAATGCCATGCGCGCTCCGGGCGAAGCCCCCGGACTGATGGCGCTCGAAATCGCCATCGACGAGATTGCCGAAAAAGTTG GGATCGATCCTGTACAATTTCGGATCGTCAACGACACGCAGGTCGATCCGGAAAAGCCGCAGCGGCCTTTTTCCCAGCGC AATCTCGTCGGCTGCCTCACACTAGGTGCGGAGCGGTTTGGCTGGCGTGAAAGAGGAAAGCCGGGTTCCAGACGGGATGG CAGCTGGCTGGTCGGCATGGGCGTCGCCGTTGCCTTCCGCAACAACCTCGTCCTTCCCTCCGGAGCCCGGGTAAAGCTCG ACCGGGAAGGCGTCGTGACTGTGGAAACCGACATGACCGACATCGGAACCGGCAGCTACACGATCATCGCCCAGACGGCG GCCGAGATGATGGGGGTCACGATCGACAAGGTCGCCGTCCAACTCGGCGACTCGCGTTTTCCGGTTTCTGCGGGTTCCGG CGGACAGTTCGGTGCGAACTCTTCCACGTCTGGCGTCTACGCAGCCTGTGTCAAGCTGCGTGAGGCCATCGCCAAGAAGC TCGGCTTCAACTCCGAAGACATCGTCTTCGAGAATGGCGAGGTCCGCTCGGGCAATCGTTCGGTGCCTCTTGCCGAAGCC GCCGGTCCGGATGGCCTTGTCGGCGAAGACACCATCAAGTGGGGCGAGCTCACCGAAACGCATCAGCAATCGACATTCGG CGCGCACTTCGTCGAGGTTGGCGTCGACATTGCCACTGGGGAAAGCCGGATCCGCAGGATGCTCGCAGTCTGTGCGGCGG GAAGAATCCTTAATCCGATCACCGCCCGAAGCCAGGTCATCGGCGCGATGACGATGGGGGCGGGCGGCGCGCTGTCCGAG GAATTGGCGGTCGACACCCGTCGCGGCTTCTTCGTCAACCACGATCTCGCCAGCTATGAAGTGGCGGTGCATGCCGACAT TCCGCACCAGGAGGTGATCTTCATGGACGAGACCGATCCGATGTCCTCGCCGATGAAGGCAAAGGGCGTCGGCGAGCTTG GCCTTTGCGGCGTCGCGGCAGCAATCGCCAACGCCGTCTATAACGCGACCGGCGTCAGGGTCCGGCACTATCCGCTGACA CTTGACAAGCTCATCGGTGGCTTGCCGGATGTGGCCTGA
Upstream 100 bases:
>100_bases GCTTCTTGCCGGCGCGCACCCGACCGAACAGAACCGTTTCAAGGTCGACCTGGTCGAGCGCACGCTCGGCGCGGTCATTG CCGAAGCAAGGGGTTGAGCC
Downstream 100 bases:
>100_bases TTATTTCGGCGGTGGTCTCGAAAGCGGACCCCCGTCACTTCCTGTAGGATTTCCGATGGATCAGACACTTGCGCCCATCA CGGCGCCAATTCCCGTCAGG
Product: putative xanthine dehydrogenase YagR, molybdenum binding subunit
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 732; Mature: 732
Protein sequence:
>732_residues MQFDTPATTNPIDNLKVVGQPIHRIDGQLKTTGRAMYAYEWHDPNMSYAYGYPVGAAIAKGRITSMDVSAAKKAPGVLAV VTTLDIGERKKGRFNTAKLFGGDEVQHYHQAIAVVVAETFEQARAAASLVKVDYAEEKGVFDLGQAKDSAVKPDESQQPD TAVGDFEAAFRSAPVTVDASYTTPDQSHAMMEPHASIAAWNGDEVTVWTSSQMIDWWRSDLATTLDIDKENIHLMSPFIG GGFGGKLFLRADAVLAVVGARAVKRPVKVALPRPLLINNTTHRPATIQRIRIGTERDGKITAIAHESWSGDLPGGGLETA VNQTRLLYAGANRMTAMRLATLHLPEGNAMRAPGEAPGLMALEIAIDEIAEKVGIDPVQFRIVNDTQVDPEKPQRPFSQR NLVGCLTLGAERFGWRERGKPGSRRDGSWLVGMGVAVAFRNNLVLPSGARVKLDREGVVTVETDMTDIGTGSYTIIAQTA AEMMGVTIDKVAVQLGDSRFPVSAGSGGQFGANSSTSGVYAACVKLREAIAKKLGFNSEDIVFENGEVRSGNRSVPLAEA AGPDGLVGEDTIKWGELTETHQQSTFGAHFVEVGVDIATGESRIRRMLAVCAAGRILNPITARSQVIGAMTMGAGGALSE ELAVDTRRGFFVNHDLASYEVAVHADIPHQEVIFMDETDPMSSPMKAKGVGELGLCGVAAAIANAVYNATGVRVRHYPLT LDKLIGGLPDVA
Sequences:
>Translated_732_residues MQFDTPATTNPIDNLKVVGQPIHRIDGQLKTTGRAMYAYEWHDPNMSYAYGYPVGAAIAKGRITSMDVSAAKKAPGVLAV VTTLDIGERKKGRFNTAKLFGGDEVQHYHQAIAVVVAETFEQARAAASLVKVDYAEEKGVFDLGQAKDSAVKPDESQQPD TAVGDFEAAFRSAPVTVDASYTTPDQSHAMMEPHASIAAWNGDEVTVWTSSQMIDWWRSDLATTLDIDKENIHLMSPFIG GGFGGKLFLRADAVLAVVGARAVKRPVKVALPRPLLINNTTHRPATIQRIRIGTERDGKITAIAHESWSGDLPGGGLETA VNQTRLLYAGANRMTAMRLATLHLPEGNAMRAPGEAPGLMALEIAIDEIAEKVGIDPVQFRIVNDTQVDPEKPQRPFSQR NLVGCLTLGAERFGWRERGKPGSRRDGSWLVGMGVAVAFRNNLVLPSGARVKLDREGVVTVETDMTDIGTGSYTIIAQTA AEMMGVTIDKVAVQLGDSRFPVSAGSGGQFGANSSTSGVYAACVKLREAIAKKLGFNSEDIVFENGEVRSGNRSVPLAEA AGPDGLVGEDTIKWGELTETHQQSTFGAHFVEVGVDIATGESRIRRMLAVCAAGRILNPITARSQVIGAMTMGAGGALSE ELAVDTRRGFFVNHDLASYEVAVHADIPHQEVIFMDETDPMSSPMKAKGVGELGLCGVAAAIANAVYNATGVRVRHYPLT LDKLIGGLPDVA >Mature_732_residues MQFDTPATTNPIDNLKVVGQPIHRIDGQLKTTGRAMYAYEWHDPNMSYAYGYPVGAAIAKGRITSMDVSAAKKAPGVLAV VTTLDIGERKKGRFNTAKLFGGDEVQHYHQAIAVVVAETFEQARAAASLVKVDYAEEKGVFDLGQAKDSAVKPDESQQPD TAVGDFEAAFRSAPVTVDASYTTPDQSHAMMEPHASIAAWNGDEVTVWTSSQMIDWWRSDLATTLDIDKENIHLMSPFIG GGFGGKLFLRADAVLAVVGARAVKRPVKVALPRPLLINNTTHRPATIQRIRIGTERDGKITAIAHESWSGDLPGGGLETA VNQTRLLYAGANRMTAMRLATLHLPEGNAMRAPGEAPGLMALEIAIDEIAEKVGIDPVQFRIVNDTQVDPEKPQRPFSQR NLVGCLTLGAERFGWRERGKPGSRRDGSWLVGMGVAVAFRNNLVLPSGARVKLDREGVVTVETDMTDIGTGSYTIIAQTA AEMMGVTIDKVAVQLGDSRFPVSAGSGGQFGANSSTSGVYAACVKLREAIAKKLGFNSEDIVFENGEVRSGNRSVPLAEA AGPDGLVGEDTIKWGELTETHQQSTFGAHFVEVGVDIATGESRIRRMLAVCAAGRILNPITARSQVIGAMTMGAGGALSE ELAVDTRRGFFVNHDLASYEVAVHADIPHQEVIFMDETDPMSSPMKAKGVGELGLCGVAAAIANAVYNATGVRVRHYPLT LDKLIGGLPDVA
Specific function: Unknown
COG id: COG1529
COG function: function code C; Aerobic-type carbon monoxide dehydrogenase, large subunit CoxL/CutL homologs
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the xanthine dehydrogenase family [H]
Homologues:
Organism=Homo sapiens, GI71773480, Length=738, Percent_Identity=23.7127371273713, Blast_Score=142, Evalue=1e-33, Organism=Homo sapiens, GI91823271, Length=735, Percent_Identity=24.3537414965986, Blast_Score=139, Evalue=1e-32, Organism=Escherichia coli, GI1786478, Length=732, Percent_Identity=68.7158469945355, Blast_Score=1001, Evalue=0.0, Organism=Escherichia coli, GI1789230, Length=754, Percent_Identity=29.4429708222812, Blast_Score=238, Evalue=1e-63, Organism=Escherichia coli, GI1789246, Length=763, Percent_Identity=26.343381389253, Blast_Score=183, Evalue=4e-47, Organism=Caenorhabditis elegans, GI17540638, Length=724, Percent_Identity=24.7237569060773, Blast_Score=150, Evalue=3e-36, Organism=Drosophila melanogaster, GI24647199, Length=732, Percent_Identity=25.2732240437158, Blast_Score=152, Evalue=7e-37, Organism=Drosophila melanogaster, GI24647201, Length=739, Percent_Identity=25.8457374830853, Blast_Score=144, Evalue=2e-34, Organism=Drosophila melanogaster, GI24647193, Length=730, Percent_Identity=23.6986301369863, Blast_Score=132, Evalue=1e-30, Organism=Drosophila melanogaster, GI24647195, Length=745, Percent_Identity=24.6979865771812, Blast_Score=125, Evalue=8e-29, Organism=Drosophila melanogaster, GI24647197, Length=771, Percent_Identity=24.124513618677, Blast_Score=118, Evalue=2e-26, Organism=Drosophila melanogaster, GI17737937, Length=702, Percent_Identity=24.7863247863248, Blast_Score=114, Evalue=2e-25,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR000674 - InterPro: IPR008274 [H]
Pfam domain/function: PF01315 Ald_Xan_dh_C; PF02738 Ald_Xan_dh_C2 [H]
EC number: =1.17.1.4 [H]
Molecular weight: Translated: 78227; Mature: 78227
Theoretical pI: Translated: 6.00; Mature: 6.00
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.5 %Cys (Translated Protein) 3.0 %Met (Translated Protein) 3.6 %Cys+Met (Translated Protein) 0.5 %Cys (Mature Protein) 3.0 %Met (Mature Protein) 3.6 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MQFDTPATTNPIDNLKVVGQPIHRIDGQLKTTGRAMYAYEWHDPNMSYAYGYPVGAAIAK CCCCCCCCCCCCCCHHCCCCCHHHCCCCEEECCCEEEEEEEECCCCCEEECCCHHHHHHC GRITSMDVSAAKKAPGVLAVVTTLDIGERKKGRFNTAKLFGGDEVQHYHQAIAVVVAETF CCCEEEECHHHHCCCCEEEEEEEECCCCCCCCCCCEEEECCCHHHHHHHHHHHHHHHHHH EQARAAASLVKVDYAEEKGVFDLGQAKDSAVKPDESQQPDTAVGDFEAAFRSAPVTVDAS HHHHHHHHHHEEECCCCCCCEECCCCCCCCCCCCCCCCCCCCCCHHHHHHCCCCEEEEEC YTTPDQSHAMMEPHASIAAWNGDEVTVWTSSQMIDWWRSDLATTLDIDKENIHLMSPFIG CCCCCCCCCCCCCCCCEEEECCCEEEEEECCHHHHHHHHCCCEEEECCCCCEEEECCCCC GGFGGKLFLRADAVLAVVGARAVKRPVKVALPRPLLINNTTHRPATIQRIRIGTERDGKI CCCCCEEEEEHHHHHHHHHHHHHCCCCEEECCCCEEECCCCCCCCEEEEEEECCCCCCEE TAIAHESWSGDLPGGGLETAVNQTRLLYAGANRMTAMRLATLHLPEGNAMRAPGEAPGLM EEEEECCCCCCCCCCCHHHHHCCEEEEEECCCCEEEEEEEEEECCCCCCCCCCCCCCCEE ALEIAIDEIAEKVGIDPVQFRIVNDTQVDPEKPQRPFSQRNLVGCLTLGAERFGWRERGK EEHHHHHHHHHHHCCCCEEEEEECCCCCCCCCCCCCCCCCCEEEEEEECHHHCCCHHCCC PGSRRDGSWLVGMGVAVAFRNNLVLPSGARVKLDREGVVTVETDMTDIGTGSYTIIAQTA CCCCCCCCEEEECCEEEEEECCEECCCCCEEEECCCCEEEEECCCCCCCCCCEEEEEEHH AEMMGVTIDKVAVQLGDSRFPVSAGSGGQFGANSSTSGVYAACVKLREAIAKKLGFNSED HHHHCCHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHCCCCCC IVFENGEVRSGNRSVPLAEAAGPDGLVGEDTIKWGELTETHQQSTFGAHFVEVGVDIATG EEEECCEECCCCCCCCCHHCCCCCCCCCCCCCCCCCCHHHHHHHHCCCEEEEECCEEECC ESRIRRMLAVCAAGRILNPITARSQVIGAMTMGAGGALSEELAVDTRRGFFVNHDLASYE HHHHHHHHHHHHCCCCCCCHHHHHHHHEEEEECCCCCCCHHHHEECCCCEEEECCCCEEE VAVHADIPHQEVIFMDETDPMSSPMKAKGVGELGLCGVAAAIANAVYNATGVRVRHYPLT EEEEECCCCCEEEEEECCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHCCCCCEEEECCCC LDKLIGGLPDVA HHHHHCCCCCCC >Mature Secondary Structure MQFDTPATTNPIDNLKVVGQPIHRIDGQLKTTGRAMYAYEWHDPNMSYAYGYPVGAAIAK CCCCCCCCCCCCCCHHCCCCCHHHCCCCEEECCCEEEEEEEECCCCCEEECCCHHHHHHC GRITSMDVSAAKKAPGVLAVVTTLDIGERKKGRFNTAKLFGGDEVQHYHQAIAVVVAETF CCCEEEECHHHHCCCCEEEEEEEECCCCCCCCCCCEEEECCCHHHHHHHHHHHHHHHHHH EQARAAASLVKVDYAEEKGVFDLGQAKDSAVKPDESQQPDTAVGDFEAAFRSAPVTVDAS HHHHHHHHHHEEECCCCCCCEECCCCCCCCCCCCCCCCCCCCCCHHHHHHCCCCEEEEEC YTTPDQSHAMMEPHASIAAWNGDEVTVWTSSQMIDWWRSDLATTLDIDKENIHLMSPFIG CCCCCCCCCCCCCCCCEEEECCCEEEEEECCHHHHHHHHCCCEEEECCCCCEEEECCCCC GGFGGKLFLRADAVLAVVGARAVKRPVKVALPRPLLINNTTHRPATIQRIRIGTERDGKI CCCCCEEEEEHHHHHHHHHHHHHCCCCEEECCCCEEECCCCCCCCEEEEEEECCCCCCEE TAIAHESWSGDLPGGGLETAVNQTRLLYAGANRMTAMRLATLHLPEGNAMRAPGEAPGLM EEEEECCCCCCCCCCCHHHHHCCEEEEEECCCCEEEEEEEEEECCCCCCCCCCCCCCCEE ALEIAIDEIAEKVGIDPVQFRIVNDTQVDPEKPQRPFSQRNLVGCLTLGAERFGWRERGK EEHHHHHHHHHHHCCCCEEEEEECCCCCCCCCCCCCCCCCCEEEEEEECHHHCCCHHCCC PGSRRDGSWLVGMGVAVAFRNNLVLPSGARVKLDREGVVTVETDMTDIGTGSYTIIAQTA CCCCCCCCEEEECCEEEEEECCEECCCCCEEEECCCCEEEEECCCCCCCCCCEEEEEEHH AEMMGVTIDKVAVQLGDSRFPVSAGSGGQFGANSSTSGVYAACVKLREAIAKKLGFNSED HHHHCCHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHCCCCCC IVFENGEVRSGNRSVPLAEAAGPDGLVGEDTIKWGELTETHQQSTFGAHFVEVGVDIATG EEEECCEECCCCCCCCCHHCCCCCCCCCCCCCCCCCCHHHHHHHHCCCEEEEECCEEECC ESRIRRMLAVCAAGRILNPITARSQVIGAMTMGAGGALSEELAVDTRRGFFVNHDLASYE HHHHHHHHHHHHCCCCCCCHHHHHHHHEEEEECCCCCCCHHHHEECCCCEEEECCCCEEE VAVHADIPHQEVIFMDETDPMSSPMKAKGVGELGLCGVAAAIANAVYNATGVRVRHYPLT EEEEECCCCCEEEEEECCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHCCCCCEEEECCCC LDKLIGGLPDVA HHHHHCCCCCCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 11206551; 11258796 [H]