Definition Mycobacterium sp. KMS chromosome, complete genome.
Accession NC_008705
Length 5,737,227

Click here to switch to the map view.

The map label for this gene is kshA [H]

Identifier: 119870757

GI number: 119870757

Start: 4952369

End: 4953526

Strand: Direct

Name: kshA [H]

Synonym: Mkms_4728

Alternate gene names: 119870757

Gene position: 4952369-4953526 (Clockwise)

Preceding gene: 119870755

Following gene: 119870758

Centisome position: 86.32

GC content: 64.77

Gene sequence:

>1158_bases
GTGAGTACCGACACCGCCCACAGCGGCATTCGCGAGATCGACACCGGAACCCTGCCCGACCGGTACGCCAGGGGCTGGCA
CTGCCTCGGCCCGGTCAACGACTACCTCGACGGCGAACCGCACTCCGTCGAGGCGTTCGGCACCAAACTCGTGGTGTTCG
CCGATTCGAAGGGCGACGTCAAGATCCTCGACGGCTACTGCCGGCACATGGGCGGCGACCTGTCCCAGGGCACCATCAAG
GGTGACGAGGTCGCCTGCCCCTTCCACGACTGGCGCTGGGGCGGCGACGGCAAGTGCAAGCTCGTGCCCTACGCCAAGCG
GACGCCGCGGCTGGCCCGCACCCGCGCCTGGACCACCGACGTGCGCAGCGGTCTGCTGTTCGTCTGGCACGACCACGAGG
GCAACCCGCCTCCCCCCGAGGTGCGCATCCCCGAGATCCCGGAGTTCGCCAGCGACGAGTGGACCGACTGGCGGTGGAAC
TCGATCCTGATCGAGGGCGCGAACTGCCGCGAGATCATCGACAACGTCACCGACATGGCGCACTTCTTCTACATCCACTT
CGGGCTGCCCACGTACTTCAAGAACGTGTTCGAGGGCCACATCGCCAGCCAGTACCTGCACAATGTGGGCCGCCCCGACG
TCAACGACATGGGCACCACCTACGGCGAAGCGCACCTCGACTCCGAGGCGTCGTATTTCGGGCCGTCGTTCATGATCAAT
TGGCTGCACAACAACTACGGCGGCTACAAGGCCGAGTCCATCCTGATCAACTGCCACTACCCGGTGACCCAGGATTCGTT
CGTGCTGCAGTGGGGCGTCATCGTCGAGAAGCCCAAGGGCATGGACGAGAAGATGACCGACAAGCTGGCGCGGACCTTCA
CCGACGGCGTCAGCAAGGGCTTCCTGCAGGACGTCGAGATCTGGAAGCACAAGACGCGTATCGACAATCCGCTGCTGGTC
GAAGAGGACGGCGCGGTCTACCAGCTGCGCCGCTGGTATCAGCAGTTCTACGTCGACGTCGCCGACGTGACCCCGGAGAT
GACCGACCGTTTCGAGATCGAGGTCGACACCACCGCGGCCAACGAGTACTGGAACACCGAGGTTCAGGAGAATCTCGCGC
GCCGCGAGGGCGAGAAAGCCGAACAGCCGACCCCATGA

Upstream 100 bases:

>100_bases
CCCAGGTCACGCGCCAATCATTGCGAGATCAGTGGACAAAACTGTAACGTGTTCTAGTTAGAGGCCTCGATATCGTGGCC
GGGACTTTGGAGGCGCCCAG

Downstream 100 bases:

>100_bases
CCTCACCGGAGGAGCAGGACGCCGAAGTCGACCGGCTGGCCCGGTCGATGCTCCTGCTGCACGGCGGCCACGATGACGAT
CACGACCACCCCGCACCGTC

Product: Rieske (2Fe-2S) domain-containing protein

Products: NA

Alternate protein names: Rieske-type oxygenase; RO [H]

Number of amino acids: Translated: 385; Mature: 384

Protein sequence:

>385_residues
MSTDTAHSGIREIDTGTLPDRYARGWHCLGPVNDYLDGEPHSVEAFGTKLVVFADSKGDVKILDGYCRHMGGDLSQGTIK
GDEVACPFHDWRWGGDGKCKLVPYAKRTPRLARTRAWTTDVRSGLLFVWHDHEGNPPPPEVRIPEIPEFASDEWTDWRWN
SILIEGANCREIIDNVTDMAHFFYIHFGLPTYFKNVFEGHIASQYLHNVGRPDVNDMGTTYGEAHLDSEASYFGPSFMIN
WLHNNYGGYKAESILINCHYPVTQDSFVLQWGVIVEKPKGMDEKMTDKLARTFTDGVSKGFLQDVEIWKHKTRIDNPLLV
EEDGAVYQLRRWYQQFYVDVADVTPEMTDRFEIEVDTTAANEYWNTEVQENLARREGEKAEQPTP

Sequences:

>Translated_385_residues
MSTDTAHSGIREIDTGTLPDRYARGWHCLGPVNDYLDGEPHSVEAFGTKLVVFADSKGDVKILDGYCRHMGGDLSQGTIK
GDEVACPFHDWRWGGDGKCKLVPYAKRTPRLARTRAWTTDVRSGLLFVWHDHEGNPPPPEVRIPEIPEFASDEWTDWRWN
SILIEGANCREIIDNVTDMAHFFYIHFGLPTYFKNVFEGHIASQYLHNVGRPDVNDMGTTYGEAHLDSEASYFGPSFMIN
WLHNNYGGYKAESILINCHYPVTQDSFVLQWGVIVEKPKGMDEKMTDKLARTFTDGVSKGFLQDVEIWKHKTRIDNPLLV
EEDGAVYQLRRWYQQFYVDVADVTPEMTDRFEIEVDTTAANEYWNTEVQENLARREGEKAEQPTP
>Mature_384_residues
STDTAHSGIREIDTGTLPDRYARGWHCLGPVNDYLDGEPHSVEAFGTKLVVFADSKGDVKILDGYCRHMGGDLSQGTIKG
DEVACPFHDWRWGGDGKCKLVPYAKRTPRLARTRAWTTDVRSGLLFVWHDHEGNPPPPEVRIPEIPEFASDEWTDWRWNS
ILIEGANCREIIDNVTDMAHFFYIHFGLPTYFKNVFEGHIASQYLHNVGRPDVNDMGTTYGEAHLDSEASYFGPSFMINW
LHNNYGGYKAESILINCHYPVTQDSFVLQWGVIVEKPKGMDEKMTDKLARTFTDGVSKGFLQDVEIWKHKTRIDNPLLVE
EDGAVYQLRRWYQQFYVDVADVTPEMTDRFEIEVDTTAANEYWNTEVQENLARREGEKAEQPTP

Specific function: Catalyzes the opening of ring B of 1,4-androstadiene- 3,17,-dione (ADD) and 4-androstene-3,17-dione (ADD) with concomitant aromatization of ring A. The ring B is subsequently hydroxylated to yield a catechol and then subject to meta- cleavage [H]

COG id: COG4638

COG function: function code PR; Phenylpropionate dioxygenase and related ring-hydroxylating dioxygenases, large terminal subunit

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Contains 1 Rieske domain [H]

Homologues:

Organism=Caenorhabditis elegans, GI71983709, Length=356, Percent_Identity=25, Blast_Score=102, Evalue=4e-22,
Organism=Drosophila melanogaster, GI161085896, Length=355, Percent_Identity=27.0422535211268, Blast_Score=127, Evalue=1e-29,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR017941 [H]

Pfam domain/function: PF00355 Rieske [H]

EC number: NA

Molecular weight: Translated: 44063; Mature: 43932

Theoretical pI: Translated: 4.81; Mature: 4.81

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.6 %Cys     (Translated Protein)
2.1 %Met     (Translated Protein)
3.6 %Cys+Met (Translated Protein)
1.6 %Cys     (Mature Protein)
1.8 %Met     (Mature Protein)
3.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSTDTAHSGIREIDTGTLPDRYARGWHCLGPVNDYLDGEPHSVEAFGTKLVVFADSKGDV
CCCCCHHCCHHHCCCCCCCHHHHCCEEECCCHHHHCCCCCCEEEECCCEEEEEECCCCCE
KILDGYCRHMGGDLSQGTIKGDEVACPFHDWRWGGDGKCKLVPYAKRTPRLARTRAWTTD
EEHHHHHHHCCCCCCCCCCCCCEEECCCCCCCCCCCCCEEEEECHHCCCCHHHHHHHHHH
VRSGLLFVWHDHEGNPPPPEVRIPEIPEFASDEWTDWRWNSILIEGANCREIIDNVTDMA
HCCCEEEEEECCCCCCCCCCCCCCCCCCCCCCCCCCEEECEEEEECCCHHHHHHHHHHHH
HFFYIHFGLPTYFKNVFEGHIASQYLHNVGRPDVNDMGTTYGEAHLDSEASYFGPSFMIN
HHHHHEECCHHHHHHHHHHHHHHHHHHHCCCCCCHHCCCCCCHHHCCCCCCCCCHHHEEE
WLHNNYGGYKAESILINCHYPVTQDSFVLQWGVIVEKPKGMDEKMTDKLARTFTDGVSKG
EHHCCCCCEEEEEEEEEECCCCCCCCEEEEECEEEECCCCCCHHHHHHHHHHHHHHHHHH
FLQDVEIWKHKTRIDNPLLVEEDGAVYQLRRWYQQFYVDVADVTPEMTDRFEIEVDTTAA
HHHHHHHHHHHHCCCCCEEEECCCHHHHHHHHHHHHHHHHHHCCCCCCCCEEEEEECCCC
NEYWNTEVQENLARREGEKAEQPTP
CCCCCHHHHHHHHHHCCCCCCCCCC
>Mature Secondary Structure 
STDTAHSGIREIDTGTLPDRYARGWHCLGPVNDYLDGEPHSVEAFGTKLVVFADSKGDV
CCCCHHCCHHHCCCCCCCHHHHCCEEECCCHHHHCCCCCCEEEECCCEEEEEECCCCCE
KILDGYCRHMGGDLSQGTIKGDEVACPFHDWRWGGDGKCKLVPYAKRTPRLARTRAWTTD
EEHHHHHHHCCCCCCCCCCCCCEEECCCCCCCCCCCCCEEEEECHHCCCCHHHHHHHHHH
VRSGLLFVWHDHEGNPPPPEVRIPEIPEFASDEWTDWRWNSILIEGANCREIIDNVTDMA
HCCCEEEEEECCCCCCCCCCCCCCCCCCCCCCCCCCEEECEEEEECCCHHHHHHHHHHHH
HFFYIHFGLPTYFKNVFEGHIASQYLHNVGRPDVNDMGTTYGEAHLDSEASYFGPSFMIN
HHHHHEECCHHHHHHHHHHHHHHHHHHHCCCCCCHHCCCCCCHHHCCCCCCCCCHHHEEE
WLHNNYGGYKAESILINCHYPVTQDSFVLQWGVIVEKPKGMDEKMTDKLARTFTDGVSKG
EHHCCCCCEEEEEEEEEECCCCCCCCEEEEECEEEECCCCCCHHHHHHHHHHHHHHHHHH
FLQDVEIWKHKTRIDNPLLVEEDGAVYQLRRWYQQFYVDVADVTPEMTDRFEIEVDTTAA
HHHHHHHHHHHHCCCCCEEEECCCHHHHHHHHHHHHHHHHHHCCCCCCCCEEEEEECCCC
NEYWNTEVQENLARREGEKAEQPTP
CCCCCHHHHHHHHHHCCCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 9634230 [H]