Definition Azoarcus sp. BH72 chromosome, complete genome.
Accession NC_008702
Length 4,376,040

Click here to switch to the map view.

The map label for this gene is tms [H]

Identifier: 119898246

GI number: 119898246

Start: 2150473

End: 2151930

Strand: Reverse

Name: tms [H]

Synonym: azo1955

Alternate gene names: 119898246

Gene position: 2151930-2150473 (Counterclockwise)

Preceding gene: 119898247

Following gene: 119898245

Centisome position: 49.18

GC content: 71.88

Gene sequence:

>1458_bases
ATGACCTCGCCCCGCACCACCGAGGGCCCCGGCCTCGCCGCCGGGCCCACGCTTGCCGAAGCGGCGGCCCGCATCGCCGC
CGGCAGCCTCAGCTGCGAAGCGCTGATGCGCGACTGCATCGCGCGCGCGCAAGCGCACCCGGAACTCAACATCTTCATCA
CGCTCGACGCCGACAACGCGCTCGCCGCCGCGCGGCGGGCCGACACCGCGCGCGCGGCGGGCCAGCCGCAGGGCCCGCTC
GCGGGGCTGCCGATCGTCGTCAAGGACAACATCCACGCCGCCGGGCTGCCCGCCACGGCAGGCACGCCGGCGCTGGCGGA
TTTCGTTCCGGCCCAGGACGCGCCCACCGTACGCAAGCTGCGCGAAGCCGGCGCGGTCATCCTCGGCAAGACCAACATGC
ACGAGCTGGCCTTCGGCGCCACCGGCTACAACCACGCCTTCCACCACCCGGACAGCGTGGGCGTGCGCAACCCCTACGAC
CCCAGCCGCATCGCCGGGGGTTCATCGTCCGGCAGCGCCGCCGCGCTCGGCGCGCGGATGGCGGTCGCGGCACTCGGCAC
CGACACCGGCGGCTCGATGCGGATTCCGTGCGCGCTCAACGGCTGCGCGTCGCTGCGGCCGTCGTGGGGCCGTTACTCCG
GCCAGGGCGTGATCCCGATCGCCAACAGCCGCGACACGGTCGGCCCGATGGCGCTGTGCATGGCGGACGTCGCGCTGCTC
GATGCGCTCATCAGCGGCGAGCAGGCGTTGCACCCGGTGCGGCTCGATAGCCTGCGTCTCGGCGTGGTGGACAGCTTCTG
GGCCAACCTCGACGACGACACCCGGGCGCTGACCGACGCCGCGGTGAAGAAGCTCGAAGCGGCCGGTGTGCGCTTCATCG
AAGTACCGGATGCGCGCTTGAAGGAACTCAACGAGCCGATCGGCTTCGCCGTGGTGTTCCACGAAGCCTACGACGACATG
GTGGCCTACCTGCGCGAGCAGGGGCCGGGAATCAGCATCGAGACCTTGTACGAACAGATCGCCAGCCCGGACGTGAAGGG
CCTGTACCGGGATCTGGTGCTGGCGCGCAAGACCTTCGGCCCCGGCGGCACCCTGGTGGATGTCGGCCCCGCCTACCAGG
AAGCGGTGCGCCACGGCCGGCCCGCACTCAAGGCGCGCTACCGCGAGCTGTTCGAGCGCTACCAGCTCGACGCCTTCGTG
TTTCCCACCACGCCCGTGGTGGCGCCGCTCGCACGCCCGGAGGTGAGCCTGCCGGAGAACTTCCAGGCGCTGATCCAGAA
CACCGAACCCGCCGCCAGCGCCTGCCTGGCGTCGATCCAGTTGCCGATCGGGCTGGGTCCGCGCACCGGGCTGCCGGTGG
GCATGGAACTGGACGGCCCGGCGGGTGGCGACCGCCGGCTGCTGTCGATCGGTATGGCGCTGGAAGCGGTGCTGGGGCGG
GTGGCATCGGCGTTCTGA

Upstream 100 bases:

>100_bases
GCCGGCGCCGCGCTGCAGGCCGTCACCCACTGGCACCGCGCGCACCCGCCGCTGTGAGCCGCCCCGATCCCGCACACACA
AGCCCCACAGGAGAAACCGC

Downstream 100 bases:

>100_bases
TCCCGTGCCCGCACAAACTCAGGCCCGCTGCGCCAACCGGCGGGCGGGCCTGTGCGCTTGAGTGGCGCCGTCTTTCTCTC
TCCCCTTCAAGGGGGTGAAG

Product: indole acetimide hydrolase

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 485; Mature: 484

Protein sequence:

>485_residues
MTSPRTTEGPGLAAGPTLAEAAARIAAGSLSCEALMRDCIARAQAHPELNIFITLDADNALAAARRADTARAAGQPQGPL
AGLPIVVKDNIHAAGLPATAGTPALADFVPAQDAPTVRKLREAGAVILGKTNMHELAFGATGYNHAFHHPDSVGVRNPYD
PSRIAGGSSSGSAAALGARMAVAALGTDTGGSMRIPCALNGCASLRPSWGRYSGQGVIPIANSRDTVGPMALCMADVALL
DALISGEQALHPVRLDSLRLGVVDSFWANLDDDTRALTDAAVKKLEAAGVRFIEVPDARLKELNEPIGFAVVFHEAYDDM
VAYLREQGPGISIETLYEQIASPDVKGLYRDLVLARKTFGPGGTLVDVGPAYQEAVRHGRPALKARYRELFERYQLDAFV
FPTTPVVAPLARPEVSLPENFQALIQNTEPAASACLASIQLPIGLGPRTGLPVGMELDGPAGGDRRLLSIGMALEAVLGR
VASAF

Sequences:

>Translated_485_residues
MTSPRTTEGPGLAAGPTLAEAAARIAAGSLSCEALMRDCIARAQAHPELNIFITLDADNALAAARRADTARAAGQPQGPL
AGLPIVVKDNIHAAGLPATAGTPALADFVPAQDAPTVRKLREAGAVILGKTNMHELAFGATGYNHAFHHPDSVGVRNPYD
PSRIAGGSSSGSAAALGARMAVAALGTDTGGSMRIPCALNGCASLRPSWGRYSGQGVIPIANSRDTVGPMALCMADVALL
DALISGEQALHPVRLDSLRLGVVDSFWANLDDDTRALTDAAVKKLEAAGVRFIEVPDARLKELNEPIGFAVVFHEAYDDM
VAYLREQGPGISIETLYEQIASPDVKGLYRDLVLARKTFGPGGTLVDVGPAYQEAVRHGRPALKARYRELFERYQLDAFV
FPTTPVVAPLARPEVSLPENFQALIQNTEPAASACLASIQLPIGLGPRTGLPVGMELDGPAGGDRRLLSIGMALEAVLGR
VASAF
>Mature_484_residues
TSPRTTEGPGLAAGPTLAEAAARIAAGSLSCEALMRDCIARAQAHPELNIFITLDADNALAAARRADTARAAGQPQGPLA
GLPIVVKDNIHAAGLPATAGTPALADFVPAQDAPTVRKLREAGAVILGKTNMHELAFGATGYNHAFHHPDSVGVRNPYDP
SRIAGGSSSGSAAALGARMAVAALGTDTGGSMRIPCALNGCASLRPSWGRYSGQGVIPIANSRDTVGPMALCMADVALLD
ALISGEQALHPVRLDSLRLGVVDSFWANLDDDTRALTDAAVKKLEAAGVRFIEVPDARLKELNEPIGFAVVFHEAYDDMV
AYLREQGPGISIETLYEQIASPDVKGLYRDLVLARKTFGPGGTLVDVGPAYQEAVRHGRPALKARYRELFERYQLDAFVF
PTTPVVAPLARPEVSLPENFQALIQNTEPAASACLASIQLPIGLGPRTGLPVGMELDGPAGGDRRLLSIGMALEAVLGRV
ASAF

Specific function: Hydrolyzes both the R- and the S-enantiomers of mandelamide, and phenylacetamide. Has lower activity on 3- phenylpropionaide and lactamide. Does not hydrolyze benzamide. Hydrolyzes esters and amides with little steric bulk. Preferentially hydrolyzes aroma

COG id: COG0154

COG function: function code J; Asp-tRNAAsn/Glu-tRNAGln amidotransferase A subunit and related amidases

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Belongs to the amidase family [H]

Homologues:

Organism=Homo sapiens, GI222831590, Length=507, Percent_Identity=27.6134122287968, Blast_Score=132, Evalue=7e-31,
Organism=Homo sapiens, GI195972892, Length=520, Percent_Identity=24.8076923076923, Blast_Score=111, Evalue=2e-24,
Organism=Caenorhabditis elegans, GI17537465, Length=495, Percent_Identity=25.2525252525253, Blast_Score=102, Evalue=4e-22,
Organism=Caenorhabditis elegans, GI17543272, Length=479, Percent_Identity=26.5135699373695, Blast_Score=97, Evalue=1e-20,
Organism=Caenorhabditis elegans, GI17556264, Length=197, Percent_Identity=32.48730964467, Blast_Score=86, Evalue=6e-17,
Organism=Caenorhabditis elegans, GI17538252, Length=211, Percent_Identity=28.9099526066351, Blast_Score=84, Evalue=2e-16,
Organism=Caenorhabditis elegans, GI17538254, Length=215, Percent_Identity=30.6976744186047, Blast_Score=71, Evalue=1e-12,
Organism=Caenorhabditis elegans, GI71990152, Length=133, Percent_Identity=33.8345864661654, Blast_Score=67, Evalue=3e-11,
Organism=Caenorhabditis elegans, GI17556278, Length=307, Percent_Identity=28.6644951140065, Blast_Score=66, Evalue=4e-11,
Organism=Caenorhabditis elegans, GI17556276, Length=307, Percent_Identity=28.6644951140065, Blast_Score=66, Evalue=4e-11,
Organism=Saccharomyces cerevisiae, GI6319685, Length=165, Percent_Identity=40.6060606060606, Blast_Score=107, Evalue=6e-24,
Organism=Saccharomyces cerevisiae, GI6323950, Length=152, Percent_Identity=40.1315789473684, Blast_Score=90, Evalue=8e-19,
Organism=Drosophila melanogaster, GI24648113, Length=489, Percent_Identity=29.038854805726, Blast_Score=135, Evalue=4e-32,
Organism=Drosophila melanogaster, GI24652985, Length=505, Percent_Identity=25.7425742574257, Blast_Score=107, Evalue=2e-23,
Organism=Drosophila melanogaster, GI19922090, Length=505, Percent_Identity=25.7425742574257, Blast_Score=107, Evalue=2e-23,
Organism=Drosophila melanogaster, GI24652981, Length=505, Percent_Identity=25.7425742574257, Blast_Score=107, Evalue=2e-23,
Organism=Drosophila melanogaster, GI24652983, Length=505, Percent_Identity=25.7425742574257, Blast_Score=107, Evalue=2e-23,
Organism=Drosophila melanogaster, GI24648435, Length=501, Percent_Identity=24.3512974051896, Blast_Score=101, Evalue=1e-21,
Organism=Drosophila melanogaster, GI24648437, Length=501, Percent_Identity=24.3512974051896, Blast_Score=101, Evalue=1e-21,
Organism=Drosophila melanogaster, GI45550774, Length=501, Percent_Identity=24.3512974051896, Blast_Score=101, Evalue=1e-21,
Organism=Drosophila melanogaster, GI24648441, Length=433, Percent_Identity=24.4803695150115, Blast_Score=91, Evalue=2e-18,
Organism=Drosophila melanogaster, GI24648439, Length=433, Percent_Identity=24.4803695150115, Blast_Score=91, Evalue=2e-18,
Organism=Drosophila melanogaster, GI161078093, Length=505, Percent_Identity=25.3465346534653, Blast_Score=82, Evalue=7e-16,
Organism=Drosophila melanogaster, GI24644968, Length=306, Percent_Identity=24.8366013071895, Blast_Score=75, Evalue=8e-14,
Organism=Drosophila melanogaster, GI21356731, Length=458, Percent_Identity=24.4541484716157, Blast_Score=72, Evalue=1e-12,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR000120
- InterPro:   IPR020556 [H]

Pfam domain/function: PF01425 Amidase [H]

EC number: =3.5.1.86 [H]

Molecular weight: Translated: 50651; Mature: 50520

Theoretical pI: Translated: 5.86; Mature: 5.86

Prosite motif: PS00571 AMIDASES

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.2 %Cys     (Translated Protein)
2.1 %Met     (Translated Protein)
3.3 %Cys+Met (Translated Protein)
1.2 %Cys     (Mature Protein)
1.9 %Met     (Mature Protein)
3.1 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MTSPRTTEGPGLAAGPTLAEAAARIAAGSLSCEALMRDCIARAQAHPELNIFITLDADNA
CCCCCCCCCCCCCCCCHHHHHHHHHHHCCCCHHHHHHHHHHHHHCCCCEEEEEEECCCCH
LAAARRADTARAAGQPQGPLAGLPIVVKDNIHAAGLPATAGTPALADFVPAQDAPTVRKL
HHHHHHHHHHHHCCCCCCCCCCCCEEEECCCCCCCCCCCCCCCHHHHHCCCCCCHHHHHH
REAGAVILGKTNMHELAFGATGYNHAFHHPDSVGVRNPYDPSRIAGGSSSGSAAALGARM
HHCCEEEEECCCHHHHEECCCCCCCCCCCCCCCCCCCCCCHHHCCCCCCCCCHHHHHHHH
AVAALGTDTGGSMRIPCALNGCASLRPSWGRYSGQGVIPIANSRDTVGPMALCMADVALL
HHEEECCCCCCCEEECEEECCHHCCCCCCCCCCCCEEEEECCCCCCHHHHHHHHHHHHHH
DALISGEQALHPVRLDSLRLGVVDSFWANLDDDTRALTDAAVKKLEAAGVRFIEVPDARL
HHHHCCHHHCCCEECCCEEECHHHHHHCCCCCHHHHHHHHHHHHHHHCCEEEEECCCHHH
KELNEPIGFAVVFHEAYDDMVAYLREQGPGISIETLYEQIASPDVKGLYRDLVLARKTFG
HHCCCCCCEEEEEHHHHHHHHHHHHHCCCCCCHHHHHHHHCCCCHHHHHHHHHHHHHCCC
PGGTLVDVGPAYQEAVRHGRPALKARYRELFERYQLDAFVFPTTPVVAPLARPEVSLPEN
CCCCEEECCHHHHHHHHCCCHHHHHHHHHHHHHHCCCEEEECCCCHHCCCCCCCCCCCHH
FQALIQNTEPAASACLASIQLPIGLGPRTGLPVGMELDGPAGGDRRLLSIGMALEAVLGR
HHHHHCCCCHHHHHHHHHHCCCCCCCCCCCCCCCEEECCCCCCCHHHHHHHHHHHHHHHH
VASAF
HHHCC
>Mature Secondary Structure 
TSPRTTEGPGLAAGPTLAEAAARIAAGSLSCEALMRDCIARAQAHPELNIFITLDADNA
CCCCCCCCCCCCCCCHHHHHHHHHHHCCCCHHHHHHHHHHHHHCCCCEEEEEEECCCCH
LAAARRADTARAAGQPQGPLAGLPIVVKDNIHAAGLPATAGTPALADFVPAQDAPTVRKL
HHHHHHHHHHHHCCCCCCCCCCCCEEEECCCCCCCCCCCCCCCHHHHHCCCCCCHHHHHH
REAGAVILGKTNMHELAFGATGYNHAFHHPDSVGVRNPYDPSRIAGGSSSGSAAALGARM
HHCCEEEEECCCHHHHEECCCCCCCCCCCCCCCCCCCCCCHHHCCCCCCCCCHHHHHHHH
AVAALGTDTGGSMRIPCALNGCASLRPSWGRYSGQGVIPIANSRDTVGPMALCMADVALL
HHEEECCCCCCCEEECEEECCHHCCCCCCCCCCCCEEEEECCCCCCHHHHHHHHHHHHHH
DALISGEQALHPVRLDSLRLGVVDSFWANLDDDTRALTDAAVKKLEAAGVRFIEVPDARL
HHHHCCHHHCCCEECCCEEECHHHHHHCCCCCHHHHHHHHHHHHHHHCCEEEEECCCHHH
KELNEPIGFAVVFHEAYDDMVAYLREQGPGISIETLYEQIASPDVKGLYRDLVLARKTFG
HHCCCCCCEEEEEHHHHHHHHHHHHHCCCCCCHHHHHHHHCCCCHHHHHHHHHHHHHCCC
PGGTLVDVGPAYQEAVRHGRPALKARYRELFERYQLDAFVFPTTPVVAPLARPEVSLPEN
CCCCEEECCHHHHHHHHCCCHHHHHHHHHHHHHHCCCEEEECCCCHHCCCCCCCCCCCHH
FQALIQNTEPAASACLASIQLPIGLGPRTGLPVGMELDGPAGGDRRLLSIGMALEAVLGR
HHHHHCCCCHHHHHHHHHHCCCCCCCCCCCCCCCEEECCCCCCCHHHHHHHHHHHHHHHH
VASAF
HHHCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 12670968 [H]