| Definition | Shigella flexneri 2a str. 2457T, complete genome. |
|---|---|
| Accession | NC_004741 |
| Length | 4,599,354 |
Click here to switch to the map view.
The map label for this gene is rutA [H]
Identifier: 30062549
GI number: 30062549
Start: 1065155
End: 1066303
Strand: Reverse
Name: rutA [H]
Synonym: S1085
Alternate gene names: 30062549
Gene position: 1066303-1065155 (Counterclockwise)
Preceding gene: 30062551
Following gene: 30062548
Centisome position: 23.18
GC content: 54.57
Gene sequence:
>1149_bases ATGCAGGATGCAGCGCCCCGTCTGACTTTCACTTTACGAGACGAAGAGAGGTTGATGATGAAAATTGGCGTATTCGTACC TATTGGCAACAACGGCTGGCTCATTTCGACCCACGCGCCGCAGTACATGCCGACCTTTGAACTGAATAAAGCCATTGCGC AAAAAGCGGAGCATTACCATTTCGATTTCGCCCTGTCGATGATCAAACTGCGTGGCTTTGGCGGCAAAACTGAGTTCTGG GATCACAACCTTGAGTCGTTCACCTTGATGGCGGGTCTGGCAGCCGTGACCTCGCGCATTCAGATTTACGCCACTGCTGC CACCTTAACGTTACCTCCGGCAATCGTCGCCCGTATGGCCGCAACCATCGACTCCATCTCTGGCGGGCGTTTTGGCGTCA ACCTCGTGACTGGCTGGCAAAAGCCCGAGTATGAGCAGATGGGTATCTGGCCTGGCGATGACTATTTCTCCCGTCGTTAC GACTATCTCACCGAATATGTTCAGGTGCTGCGCGACCTGTGGGGCACGGGGAAAAGCGATTTTAAAGGCGATTTTTTCAC CATGAATGATTGTCGCGTCAGTCCGCAACCGAGTATCCCCATGAAAGTGATCTGCGCCGGGCAAAGCGACGCTGGCATGG CGTTCTCCGCCCAGTATGCCGATTTCAACTTCTGTTTCGGCAAAGGCGTAAATACACCCACGGCTTTCGCCCCGACCGCT GCGCGGATGAAACAGGCCACAGAGCAAACCGGACGCGACGTTGGCTCTTATGTGTTGTTTATGGTGATTGCCGATGAAAC CGACGATGCCACTCGCGCCAAATGGGAACACTACAAAGCGGGCGCGGATGAAGAGGCGTTAAGCTGGCTAACCGAACAAA GTCAGAAAGATACCCGCTCCGGTACTGACACCAACGTTCGTCAGATGGCCGATCCCACTTCGGCGGTAAACATCAATATG GGGACGTTAGTCGGTTCTTACGCCAGTGTCGCGCGCATGTTAGATGAAGTCGCAAGCGTGCCTGGTGCAGAAGGCGTGCT GTTGACCTTCGATGATTTTCTGTCGGGAATCGAAACCTTCGGCGAGCGCATTCAACCACTGATGCAGTGCCGCGCCCATC TCTCTGCGCTGACTCAGGAGGTGGCATGA
Upstream 100 bases:
>100_bases CAGATATTTTAGATAACACAATGCTAACACATTAATAATATTCACTTTTTAAAAACTGGCATCCGCTTTGCGAACAAGCC AATACGCGGCTGAAAAGGAT
Downstream 100 bases:
>100_bases TGACAACCTTAACCGCTCGACCGGAAGCCATTACCTTCGATCCGCAGCAAAGTGCGCAGATCGTGGTGGATATGCAAAAC GCTTATGCCACGCCAGGCGG
Product: hypothetical protein
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 382; Mature: 382
Protein sequence:
>382_residues MQDAAPRLTFTLRDEERLMMKIGVFVPIGNNGWLISTHAPQYMPTFELNKAIAQKAEHYHFDFALSMIKLRGFGGKTEFW DHNLESFTLMAGLAAVTSRIQIYATAATLTLPPAIVARMAATIDSISGGRFGVNLVTGWQKPEYEQMGIWPGDDYFSRRY DYLTEYVQVLRDLWGTGKSDFKGDFFTMNDCRVSPQPSIPMKVICAGQSDAGMAFSAQYADFNFCFGKGVNTPTAFAPTA ARMKQATEQTGRDVGSYVLFMVIADETDDATRAKWEHYKAGADEEALSWLTEQSQKDTRSGTDTNVRQMADPTSAVNINM GTLVGSYASVARMLDEVASVPGAEGVLLTFDDFLSGIETFGERIQPLMQCRAHLSALTQEVA
Sequences:
>Translated_382_residues MQDAAPRLTFTLRDEERLMMKIGVFVPIGNNGWLISTHAPQYMPTFELNKAIAQKAEHYHFDFALSMIKLRGFGGKTEFW DHNLESFTLMAGLAAVTSRIQIYATAATLTLPPAIVARMAATIDSISGGRFGVNLVTGWQKPEYEQMGIWPGDDYFSRRY DYLTEYVQVLRDLWGTGKSDFKGDFFTMNDCRVSPQPSIPMKVICAGQSDAGMAFSAQYADFNFCFGKGVNTPTAFAPTA ARMKQATEQTGRDVGSYVLFMVIADETDDATRAKWEHYKAGADEEALSWLTEQSQKDTRSGTDTNVRQMADPTSAVNINM GTLVGSYASVARMLDEVASVPGAEGVLLTFDDFLSGIETFGERIQPLMQCRAHLSALTQEVA >Mature_382_residues MQDAAPRLTFTLRDEERLMMKIGVFVPIGNNGWLISTHAPQYMPTFELNKAIAQKAEHYHFDFALSMIKLRGFGGKTEFW DHNLESFTLMAGLAAVTSRIQIYATAATLTLPPAIVARMAATIDSISGGRFGVNLVTGWQKPEYEQMGIWPGDDYFSRRY DYLTEYVQVLRDLWGTGKSDFKGDFFTMNDCRVSPQPSIPMKVICAGQSDAGMAFSAQYADFNFCFGKGVNTPTAFAPTA ARMKQATEQTGRDVGSYVLFMVIADETDDATRAKWEHYKAGADEEALSWLTEQSQKDTRSGTDTNVRQMADPTSAVNINM GTLVGSYASVARMLDEVASVPGAEGVLLTFDDFLSGIETFGERIQPLMQCRAHLSALTQEVA
Specific function: Catalyzes the pyrimidine ring opening between N-3 and C- 4 by an unusual flavin hydroperoxide-catalyzed mechanism to yield ureidoacrylate peracid. It cleaves pyrmidine rings directly by adding oxygen atoms, making a toxic ureidoacrylate peracid product wh
COG id: COG2141
COG function: function code C; Coenzyme F420-dependent N5,N10-methylene tetrahydromethanopterin reductase and related flavin-dependent oxidoreductases
Gene ontology:
Cell location: Cytoplasmic
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the ntaA/snaA/soxA(dszA) monooxygenase family. RutA subfamily [H]
Homologues:
Organism=Escherichia coli, GI1787247, Length=382, Percent_Identity=98.4293193717278, Blast_Score=788, Evalue=0.0, Organism=Escherichia coli, GI1787166, Length=305, Percent_Identity=23.9344262295082, Blast_Score=66, Evalue=4e-12,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR011251 - InterPro: IPR019914 - InterPro: IPR016048 [H]
Pfam domain/function: PF00296 Bac_luciferase [H]
EC number: NA
Molecular weight: Translated: 42227; Mature: 42227
Theoretical pI: Translated: 4.81; Mature: 4.81
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.0 %Cys (Translated Protein) 4.5 %Met (Translated Protein) 5.5 %Cys+Met (Translated Protein) 1.0 %Cys (Mature Protein) 4.5 %Met (Mature Protein) 5.5 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MQDAAPRLTFTLRDEERLMMKIGVFVPIGNNGWLISTHAPQYMPTFELNKAIAQKAEHYH CCCCCCCEEEEECCHHHEEEEEEEEEEECCCCEEEECCCCCCCCCHHHHHHHHHHHHHHH FDFALSMIKLRGFGGKTEFWDHNLESFTLMAGLAAVTSRIQIYATAATLTLPPAIVARMA HHHHHHHHHHHCCCCCCCCCCCCCHHHHHHHHHHHHHHCEEEEEEEEEEECCHHHHHHHH ATIDSISGGRFGVNLVTGWQKPEYEQMGIWPGDDYFSRRYDYLTEYVQVLRDLWGTGKSD HHHHCCCCCEEEEEEEECCCCCCHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCC FKGDFFTMNDCRVSPQPSIPMKVICAGQSDAGMAFSAQYADFNFCFGKGVNTPTAFAPTA CCCCCEEECCCCCCCCCCCCEEEEEECCCCCCCEEEEECCCCEEEECCCCCCCCCCCCHH ARMKQATEQTGRDVGSYVLFMVIADETDDATRAKWEHYKAGADEEALSWLTEQSQKDTRS HHHHHHHHHHHHHHHCEEEEEEEECCCCCHHHHHHHHHCCCCCHHHHHHHHHHHHHHCCC GTDTNVRQMADPTSAVNINMGTLVGSYASVARMLDEVASVPGAEGVLLTFDDFLSGIETF CCCCCHHHHCCCCCEEEEEHHHHHHHHHHHHHHHHHHHHCCCCCEEEEEHHHHHHHHHHH GERIQPLMQCRAHLSALTQEVA HHHHHHHHHHHHHHHHHHHHCC >Mature Secondary Structure MQDAAPRLTFTLRDEERLMMKIGVFVPIGNNGWLISTHAPQYMPTFELNKAIAQKAEHYH CCCCCCCEEEEECCHHHEEEEEEEEEEECCCCEEEECCCCCCCCCHHHHHHHHHHHHHHH FDFALSMIKLRGFGGKTEFWDHNLESFTLMAGLAAVTSRIQIYATAATLTLPPAIVARMA HHHHHHHHHHHCCCCCCCCCCCCCHHHHHHHHHHHHHHCEEEEEEEEEEECCHHHHHHHH ATIDSISGGRFGVNLVTGWQKPEYEQMGIWPGDDYFSRRYDYLTEYVQVLRDLWGTGKSD HHHHCCCCCEEEEEEEECCCCCCHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCC FKGDFFTMNDCRVSPQPSIPMKVICAGQSDAGMAFSAQYADFNFCFGKGVNTPTAFAPTA CCCCCEEECCCCCCCCCCCCEEEEEECCCCCCCEEEEECCCCEEEECCCCCCCCCCCCHH ARMKQATEQTGRDVGSYVLFMVIADETDDATRAKWEHYKAGADEEALSWLTEQSQKDTRS HHHHHHHHHHHHHHHCEEEEEEEECCCCCHHHHHHHHHCCCCCHHHHHHHHHHHHHHCCC GTDTNVRQMADPTSAVNINMGTLVGSYASVARMLDEVASVPGAEGVLLTFDDFLSGIETF CCCCCHHHHCCCCCEEEEEHHHHHHHHHHHHHHHHHHHHCCCCCEEEEEHHHHHHHHHHH GERIQPLMQCRAHLSALTQEVA HHHHHHHHHHHHHHHHHHHHCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: NA