| Definition | Pseudomonas syringae pv. syringae B728a, complete genome. |
|---|---|
| Accession | NC_007005 |
| Length | 6,093,698 |
Click here to switch to the map view.
The map label for this gene is arnA
Identifier: 66045927
GI number: 66045927
Start: 3267178
End: 3269172
Strand: Direct
Name: arnA
Synonym: Psyr_2691
Alternate gene names: 66045927
Gene position: 3267178-3269172 (Clockwise)
Preceding gene: 66045926
Following gene: 66045928
Centisome position: 53.62
GC content: 59.65
Gene sequence:
>1995_bases ATGAGCACTAAAGCTGTCGTTTTCGCTTATCACGATATTGGCTGTGTCGGCCTGCAAGCGTTGCTGGATGCAGGCTATGA GATTGCGGCGGTGTTCACCCATGCCGACGACCCCAGGGAAAAAACCTTTTTCGGCTCTGTGGCGCAGCTGTGCGCCCGGC ACGGCATTGCAGTGCATGCCCCCGAGGACCCGAATCACCCGCTATGGGTAGAGCGCATCGGCAAACTGGCGCCGGACTTC ATTTTCTCCTTCTACTATCGCCAGTTACTCGGCGATTCGTTGCTGGCCTGCGCGAAAAAAGCTGCACTGAACCTGCATGG CTCGCTGCTTCCGCGTTATCGCGGACGCGCGCCGGCCAACTGGGTGCTGGTCAACGGCGAAAGCGAAACCGGCGTTACCC TGCATCAGATGGTCAAACGCGCCGATGCCGGGCCGATAGTCGCCCAGCAGCGGGTCTCGATCAGTGCCACCGATACCGCC TTGACGCTGCATGGCAAATTGCGTGACGCCGCCGCTGACCTGCTCTGCGAGACACTGCCCTTGCTCGCCGCACAAGGGCA ACTGCCAGCGACACCCCAGGATGAATCGCGTGCGACGTATTTCGGTCGGCGCACCCCGGCCGACGGTTTGATCGACTGGT CGCTGCCAGCCACTCAGCTCTATAACCTGATCCGCGCGGTAACACAGCCCTACCCTGGCGCGTTTTGCCCGGTCGGCGAC AACAAGCTGATCGTCTGGGCTGCCAGCGTGGACACAAGCAGCAATGGCGAGGCGCCGGGCACGGTCATCAGTCACGAGCC GTTGCGTATCGCCTGTGGCGAGGGTTCGCTGGTCATCACCGCAGGGCAACGCGGTGACAACGGCTTGTACCTCAGTGGTG AGCAACTGGCACGCGAATTCGGGCTGGTAGCAGGCTCGCAAATGCTCGATAAGGCAAAGCGCCGGTCGGTTCGTCGTACC CGCGTGTTGATCCTCGGCGTCAACGGTTTCATCGGCAACCACCTGTCAGAGCGTCTGTTGCAGGATGACCGTTACGAAAT CTACGGCATGGATATCGGCTCGGACGCTATCGAGCGCTTGCGCGCCAAGCCGAACTTTCACTTCATCGAAGGTGACATCA GCATCCACACCGAGTGGATCGAATACCACATCAAGAAGTGCGATGTCGTGCTGCCGCTGGTGGCTATCGCCACGCCGATT GAATACACGCGCAATCCACTGCGGGTCTTCGAGCTGGATTTCGAAGAGAACCTGAAGATCGTCCGCTACTGCGTCAAGTA CAACAAGCGTGTGATTTTCCCGTCCACGTCCGAAGTCTATGGCATGTGCCAGGACGCAAACTTCAACGAGGACACCTCCA ACCTGATCGTTGGCCCGATCAACAAGCAGCGCTGGATCTACTCGGTGTCCAAGCAACTGCTGGACCGGGTGATCTGGGCC TATGGCCAGAAAGGCCTGCAATTCACCCTGTTTCGCCCGTTCAACTGGATGGGACCGCGTCTGGACCGCCTGGATTCGGC GCGCATTGGCAGTTCGCGGGCCATCACCCAACTGATCCTGCACCTGGTCGAAGGCACGCCCATTCGCCTGGTGGACGGCG GCGCCCAGAAGCGCTGTTTCACCGATGTCGTCGACGGCATCGAAGCGCTGGCGCGGATCATCGAAAACCGCGATGGGCGC TGTAACGGACAGATCATCAACATCGGCAACCCCGACAACGAAGCCAGCATCCGTCAATTGGGTGAAGAGCTGCTTCGCCA GTTCGAAGCCCATCCGTTGCGCGGCCATTTCCCGCCTTTCGCGGGCTTTCGTGAAGTCGAAAGCCAGTCCTTCTATGGCA AGGGCTATCAGGATGTCAGCCATCGCACGCCGAGCATCGACAACGCCAAAAAGCTGATTGGCTGGACGCCGGGTATCGAG CTGAGCGAAACCATCGGCAAAACCCTGGATTTCTTCCTGCGCGAAGCCATGGCTGAAAAAGCGGATCAGTGCTGA
Upstream 100 bases:
>100_bases GTCCGCGGTTCTTCATCGAAAAAATCGTGCGCAGCTCGTCACCGGTTGCCACCGACAGCATTGATTCCTCTGTAACTCCC TATATGAACAAGGTCGCGCC
Downstream 100 bases:
>100_bases TGCAGGCAGGCCTGAGAATCGATGTCGACACTTACCGGGGCACCCGTGAGGGCGTGCCCCGGCTGCTGGACATACTCGAC GAAGCGCAGGTCAAGGCGAC
Product: bifunctional UDP-glucuronic acid decarboxylase/UDP-4-amino-4-deoxy-L-arabinose formyltransferase
Products: NA
Alternate protein names: UDP-4-amino-4-deoxy-L-arabinose formyltransferase; ArnAFT; UDP-L-Ara4N formyltransferase; UDP-glucuronic acid oxidase, UDP-4-keto-hexauronic acid decarboxylating; ArnADH; UDP-GlcUA decarboxylase; UDP-glucuronic acid dehydrogenase
Number of amino acids: Translated: 664; Mature: 663
Protein sequence:
>664_residues MSTKAVVFAYHDIGCVGLQALLDAGYEIAAVFTHADDPREKTFFGSVAQLCARHGIAVHAPEDPNHPLWVERIGKLAPDF IFSFYYRQLLGDSLLACAKKAALNLHGSLLPRYRGRAPANWVLVNGESETGVTLHQMVKRADAGPIVAQQRVSISATDTA LTLHGKLRDAAADLLCETLPLLAAQGQLPATPQDESRATYFGRRTPADGLIDWSLPATQLYNLIRAVTQPYPGAFCPVGD NKLIVWAASVDTSSNGEAPGTVISHEPLRIACGEGSLVITAGQRGDNGLYLSGEQLAREFGLVAGSQMLDKAKRRSVRRT RVLILGVNGFIGNHLSERLLQDDRYEIYGMDIGSDAIERLRAKPNFHFIEGDISIHTEWIEYHIKKCDVVLPLVAIATPI EYTRNPLRVFELDFEENLKIVRYCVKYNKRVIFPSTSEVYGMCQDANFNEDTSNLIVGPINKQRWIYSVSKQLLDRVIWA YGQKGLQFTLFRPFNWMGPRLDRLDSARIGSSRAITQLILHLVEGTPIRLVDGGAQKRCFTDVVDGIEALARIIENRDGR CNGQIINIGNPDNEASIRQLGEELLRQFEAHPLRGHFPPFAGFREVESQSFYGKGYQDVSHRTPSIDNAKKLIGWTPGIE LSETIGKTLDFFLREAMAEKADQC
Sequences:
>Translated_664_residues MSTKAVVFAYHDIGCVGLQALLDAGYEIAAVFTHADDPREKTFFGSVAQLCARHGIAVHAPEDPNHPLWVERIGKLAPDF IFSFYYRQLLGDSLLACAKKAALNLHGSLLPRYRGRAPANWVLVNGESETGVTLHQMVKRADAGPIVAQQRVSISATDTA LTLHGKLRDAAADLLCETLPLLAAQGQLPATPQDESRATYFGRRTPADGLIDWSLPATQLYNLIRAVTQPYPGAFCPVGD NKLIVWAASVDTSSNGEAPGTVISHEPLRIACGEGSLVITAGQRGDNGLYLSGEQLAREFGLVAGSQMLDKAKRRSVRRT RVLILGVNGFIGNHLSERLLQDDRYEIYGMDIGSDAIERLRAKPNFHFIEGDISIHTEWIEYHIKKCDVVLPLVAIATPI EYTRNPLRVFELDFEENLKIVRYCVKYNKRVIFPSTSEVYGMCQDANFNEDTSNLIVGPINKQRWIYSVSKQLLDRVIWA YGQKGLQFTLFRPFNWMGPRLDRLDSARIGSSRAITQLILHLVEGTPIRLVDGGAQKRCFTDVVDGIEALARIIENRDGR CNGQIINIGNPDNEASIRQLGEELLRQFEAHPLRGHFPPFAGFREVESQSFYGKGYQDVSHRTPSIDNAKKLIGWTPGIE LSETIGKTLDFFLREAMAEKADQC >Mature_663_residues STKAVVFAYHDIGCVGLQALLDAGYEIAAVFTHADDPREKTFFGSVAQLCARHGIAVHAPEDPNHPLWVERIGKLAPDFI FSFYYRQLLGDSLLACAKKAALNLHGSLLPRYRGRAPANWVLVNGESETGVTLHQMVKRADAGPIVAQQRVSISATDTAL TLHGKLRDAAADLLCETLPLLAAQGQLPATPQDESRATYFGRRTPADGLIDWSLPATQLYNLIRAVTQPYPGAFCPVGDN KLIVWAASVDTSSNGEAPGTVISHEPLRIACGEGSLVITAGQRGDNGLYLSGEQLAREFGLVAGSQMLDKAKRRSVRRTR VLILGVNGFIGNHLSERLLQDDRYEIYGMDIGSDAIERLRAKPNFHFIEGDISIHTEWIEYHIKKCDVVLPLVAIATPIE YTRNPLRVFELDFEENLKIVRYCVKYNKRVIFPSTSEVYGMCQDANFNEDTSNLIVGPINKQRWIYSVSKQLLDRVIWAY GQKGLQFTLFRPFNWMGPRLDRLDSARIGSSRAITQLILHLVEGTPIRLVDGGAQKRCFTDVVDGIEALARIIENRDGRC NGQIINIGNPDNEASIRQLGEELLRQFEAHPLRGHFPPFAGFREVESQSFYGKGYQDVSHRTPSIDNAKKLIGWTPGIEL SETIGKTLDFFLREAMAEKADQC
Specific function: Bifunctional enzyme that catalyzes the oxidative decarboxylation of UDP-glucuronic acid (UDP-GlcUA) to UDP-4-keto- arabinose (UDP-Ara4O) and the addition of a formyl group to UDP-4- amino-4-deoxy-L-arabinose (UDP-L-Ara4N) to form UDP-L-4-formamido- arabin
COG id: COG0451
COG function: function code MG; Nucleoside-diphosphate-sugar epimerases
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: In the C-terminal section; belongs to the sugar epimerase family. UDP-glucuronic acid decarboxylase subfamily
Homologues:
Organism=Homo sapiens, GI42516563, Length=352, Percent_Identity=25.8522727272727, Blast_Score=111, Evalue=3e-24, Organism=Homo sapiens, GI21614513, Length=245, Percent_Identity=25.3061224489796, Blast_Score=83, Evalue=9e-16, Organism=Homo sapiens, GI238814322, Length=210, Percent_Identity=27.6190476190476, Blast_Score=79, Evalue=2e-14, Organism=Homo sapiens, GI164663775, Length=206, Percent_Identity=29.126213592233, Blast_Score=68, Evalue=3e-11, Organism=Escherichia coli, GI1788589, Length=652, Percent_Identity=68.558282208589, Blast_Score=934, Evalue=0.0, Organism=Escherichia coli, GI1789683, Length=278, Percent_Identity=33.8129496402878, Blast_Score=130, Evalue=2e-31, Organism=Caenorhabditis elegans, GI17539532, Length=353, Percent_Identity=24.929178470255, Blast_Score=102, Evalue=8e-22, Organism=Caenorhabditis elegans, GI133930964, Length=254, Percent_Identity=25.9842519685039, Blast_Score=80, Evalue=4e-15, Organism=Drosophila melanogaster, GI21356223, Length=438, Percent_Identity=26.7123287671233, Blast_Score=95, Evalue=2e-19, Organism=Drosophila melanogaster, GI45550868, Length=144, Percent_Identity=33.3333333333333, Blast_Score=74, Evalue=3e-13, Organism=Drosophila melanogaster, GI28571984, Length=144, Percent_Identity=33.3333333333333, Blast_Score=74, Evalue=4e-13,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): ARNA_PSEU2 (Q4ZSZ2)
Other databases:
- EMBL: CP000075 - RefSeq: YP_235768.1 - ProteinModelPortal: Q4ZSZ2 - SMR: Q4ZSZ2 - STRING: Q4ZSZ2 - GeneID: 3368208 - GenomeReviews: CP000075_GR - KEGG: psb:Psyr_2691 - NMPDR: fig|205918.4.peg.1767 - eggNOG: COG0451 - HOGENOM: HBG298638 - OMA: KAVVFAY - ProtClustDB: PRK08125 - BioCyc: PSYR205918:PSYR_2691-MONOMER - HAMAP: MF_01166 - InterPro: IPR021168 - InterPro: IPR001509 - InterPro: IPR005793 - InterPro: IPR002376 - InterPro: IPR011034 - InterPro: IPR016040 - Gene3D: G3DSA:3.10.25.10 - Gene3D: G3DSA:3.40.50.170 - Gene3D: G3DSA:3.40.50.720 - PIRSF: PIRSF036506
Pfam domain/function: PF01370 Epimerase; PF02911 Formyl_trans_C; PF00551 Formyl_trans_N; SSF50486 FMT_C_like; SSF53328 formyl_transf
EC number: =2.1.2.13; =1.1.1.305
Molecular weight: Translated: 73758; Mature: 73627
Theoretical pI: Translated: 6.97; Mature: 6.97
Prosite motif: NA
Important sites: ACT_SITE 106-106 ACT_SITE 438-438 ACT_SITE 622-622 BINDING 116-116 BINDING 351-351 BINDING 397-397 BINDING 402-402 BINDING 464-464 BINDING 495-495 BINDING 616-616
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.8 %Cys (Translated Protein) 1.1 %Met (Translated Protein) 2.9 %Cys+Met (Translated Protein) 1.8 %Cys (Mature Protein) 0.9 %Met (Mature Protein) 2.7 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MSTKAVVFAYHDIGCVGLQALLDAGYEIAAVFTHADDPREKTFFGSVAQLCARHGIAVHA CCCCEEEEEECCCHHHHHHHHHHCCCEEEEEEECCCCCHHHHHHHHHHHHHHHCCEEEEC PEDPNHPLWVERIGKLAPDFIFSFYYRQLLGDSLLACAKKAALNLHGSLLPRYRGRAPAN CCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCHHCCCCCCC WVLVNGESETGVTLHQMVKRADAGPIVAQQRVSISATDTALTLHGKLRDAAADLLCETLP EEEEECCCCCCHHHHHHHHHCCCCCCEECCCEEEEECCEEEEEECHHHHHHHHHHHHHHH LLAAQGQLPATPQDESRATYFGRRTPADGLIDWSLPATQLYNLIRAVTQPYPGAFCPVGD HHHCCCCCCCCCCCCCCHHCCCCCCCCCCEEECCCCHHHHHHHHHHHHCCCCCCCCCCCC NKLIVWAASVDTSSNGEAPGTVISHEPLRIACGEGSLVITAGQRGDNGLYLSGEQLAREF CEEEEEEEECCCCCCCCCCCCEECCCCEEEEECCCCEEEEECCCCCCCEEECHHHHHHHH GLVAGSQMLDKAKRRSVRRTRVLILGVNGFIGNHLSERLLQDDRYEIYGMDIGSDAIERL HHHHHHHHHHHHHHHHHHHEEEEEEECCCHHHHHHHHHHHCCCCEEEEEECCCHHHHHHH RAKPNFHFIEGDISIHTEWIEYHIKKCDVVLPLVAIATPIEYTRNPLRVFELDFEENLKI HCCCCEEEEECCEEEEHHHHHHHHHHHHHHHHHHHHHCCHHHCCCCEEEEEECHHHCHHH VRYCVKYNKRVIFPSTSEVYGMCQDANFNEDTSNLIVGPINKQRWIYSVSKQLLDRVIWA HHHHHHHCCEEECCCCHHHHEEECCCCCCCCCCCEEEECCCCCHHHHHHHHHHHHHHHHH YGQKGLQFTLFRPFNWMGPRLDRLDSARIGSSRAITQLILHLVEGTPIRLVDGGAQKRCF HCCCCCEEEEECCCCCCCCHHHHCCHHCCCCHHHHHHHHHHHHCCCCEEEECCCCCHHHH TDVVDGIEALARIIENRDGRCNGQIINIGNPDNEASIRQLGEELLRQFEAHPLRGHFPPF HHHHHHHHHHHHHHHCCCCCCCCEEEECCCCCCHHHHHHHHHHHHHHHCCCCCCCCCCCC AGFREVESQSFYGKGYQDVSHRTPSIDNAKKLIGWTPGIELSETIGKTLDFFLREAMAEK CCHHHHHCCCCCCCCCHHHHCCCCCCCCCHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHH ADQC CCCC >Mature Secondary Structure STKAVVFAYHDIGCVGLQALLDAGYEIAAVFTHADDPREKTFFGSVAQLCARHGIAVHA CCCEEEEEECCCHHHHHHHHHHCCCEEEEEEECCCCCHHHHHHHHHHHHHHHCCEEEEC PEDPNHPLWVERIGKLAPDFIFSFYYRQLLGDSLLACAKKAALNLHGSLLPRYRGRAPAN CCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCHHCCCCCCC WVLVNGESETGVTLHQMVKRADAGPIVAQQRVSISATDTALTLHGKLRDAAADLLCETLP EEEEECCCCCCHHHHHHHHHCCCCCCEECCCEEEEECCEEEEEECHHHHHHHHHHHHHHH LLAAQGQLPATPQDESRATYFGRRTPADGLIDWSLPATQLYNLIRAVTQPYPGAFCPVGD HHHCCCCCCCCCCCCCCHHCCCCCCCCCCEEECCCCHHHHHHHHHHHHCCCCCCCCCCCC NKLIVWAASVDTSSNGEAPGTVISHEPLRIACGEGSLVITAGQRGDNGLYLSGEQLAREF CEEEEEEEECCCCCCCCCCCCEECCCCEEEEECCCCEEEEECCCCCCCEEECHHHHHHHH GLVAGSQMLDKAKRRSVRRTRVLILGVNGFIGNHLSERLLQDDRYEIYGMDIGSDAIERL HHHHHHHHHHHHHHHHHHHEEEEEEECCCHHHHHHHHHHHCCCCEEEEEECCCHHHHHHH RAKPNFHFIEGDISIHTEWIEYHIKKCDVVLPLVAIATPIEYTRNPLRVFELDFEENLKI HCCCCEEEEECCEEEEHHHHHHHHHHHHHHHHHHHHHCCHHHCCCCEEEEEECHHHCHHH VRYCVKYNKRVIFPSTSEVYGMCQDANFNEDTSNLIVGPINKQRWIYSVSKQLLDRVIWA HHHHHHHCCEEECCCCHHHHEEECCCCCCCCCCCEEEECCCCCHHHHHHHHHHHHHHHHH YGQKGLQFTLFRPFNWMGPRLDRLDSARIGSSRAITQLILHLVEGTPIRLVDGGAQKRCF HCCCCCEEEEECCCCCCCCHHHHCCHHCCCCHHHHHHHHHHHHCCCCEEEECCCCCHHHH TDVVDGIEALARIIENRDGRCNGQIINIGNPDNEASIRQLGEELLRQFEAHPLRGHFPPF HHHHHHHHHHHHHHHCCCCCCCCEEEECCCCCCHHHHHHHHHHHHHHHCCCCCCCCCCCC AGFREVESQSFYGKGYQDVSHRTPSIDNAKKLIGWTPGIELSETIGKTLDFFLREAMAEK CCHHHHHCCCCCCCCCHHHHCCCCCCCCCHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHH ADQC CCCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: NA