Definition Ralstonia solanacearum GMI1000, complete genome.
Accession NC_003295
Length 3,716,413

Click here to switch to the map view.

The map label for this gene is 17547870

Identifier: 17547870

GI number: 17547870

Start: 3401819

End: 3403942

Strand: Direct

Name: 17547870

Synonym: RSc3151

Alternate gene names: NA

Gene position: 3401819-3403942 (Clockwise)

Preceding gene: 17547869

Following gene: 17547875

Centisome position: 91.54

GC content: 67.04

Gene sequence:

>2124_bases
ATGGGTATTACCGTCATGCCGGGCCTCACCAGCATGGAAAGCGATACGCGCACGCAGCGGATTTCGACAACGATCGGCCA
GGCCAGGCTGAACGGCCGGTTCTATCGGCATCCCGATTCCGCATTGGTTTCGTATCCCGTCGCGGTCGACAATGCGCTCG
GCGCGCTGCCGGATCGCGCCTACAACATCGCGATCGTCGGCGGCGGCGCGGCCGGGATCGCATCGCTGTACGAACTGTCG
CGGCTCGCGAAGACACTCTCGGCCGGGACGATGACCGTCACGCTCTACGAATCCGATCCGGACAGTTTCCTCACCAGGCT
TGAAGCCGGCACCCAGGCCATCAACGTGCGCGGGCTCAAGGCCGGCCGCGTCTCCGCCGCCCGCGTCAACCAGAACGACA
CGGTGTACGAAGTCGGCGCGATGCGCTTTCCGGAAATCGCCGGGCTGACGTGGCACTACGCGAGTGTCGTGTACGGCGAC
GGCGCGCCGATCAAGGTGTTCCCGAATCCCGGCAAGGTGCCGACCGAATTCATGTTCGGTGACCGCATCGACCGCTACAG
CGGCAGTGCGCCCGAGGATTGGCTGGACCGGGAATCGCCGGCGCGCAAGGTGTTTCTCGTGGTCGCGAGCGGGCTCGCCG
GCGCGCCCGACAGCCAAACGCCCATCGCACTCTTTCCGATCGGCGGCCGCGATCCGGTGCAGGTCGCGCAGTTGCTGAAA
AGCGAAACGGCCGGACCCGCGCAGCTGCGGGCCATTCAGGAGCGCGACTGGCCGGCCTTCATCGCGGCGCACGACGGCAC
CACGCTCGAAGCGGCCGTCCGGCGCATCGTGACGCGCGAGATCGGCAAGGGTGCCGCGAGCAGCCTGCCGCCGATCGCCG
GCCTCGACCCGGCGGAGACGATCAACTACTACGTCGAGCTGTTCGGCCGCTTCGGTTTTGGCACGGGCGGGTTCAAGCCG
CTGTTCAACATCTCGCTCGTCGAGATGATGCGGCTGATCCTGTGGGACTACTCGAACGAATACACGCTGCCCGTCGAGGA
GAATGTCGAATTCATCGCTGGCCTGTATCAGAAAGCGCTTGAGCAGGGCGGCTCGCGCCTGACGGTCAATGTGCGCCGGG
AGCGGGTCTCCGATGTCTGCCACTCCGACGCCGCGCGTGTCCGGCAGCCGTTTGTGGTTGCGTACGATCGGGCGGGCAAG
CTCTCGGCGCCCAACTACGATTACGTCATCCTGGCCGCCCCGCAGGACCAGCTCGCCTTGGCGGTCAGCCGATCCGGATA
CGCGTTCGGGCCGGCCAGCCTCGTGCTGGGCGACGGCGCGCTGGGGCTGGGCACGATCACCATCCGGGACGCCCTCCCCC
CGCTGCTGCTCAGCGATACCAGCTCGGCGCCGAACGCGCGCATCGTGACGGCACTGAACCAGCTCCACATGGTCCGGTCG
TCCAAGGTCTTCGGCACCATCGAAACGGCGAGGCTCGATGAGCCGTTCGTGCCGCGCCTCAAGGGCCAGCCGATCAAGGC
GGTCGTATCGGACTCCGGCCTCGCCGCCAGCTACGTGGTGCCCAGCCCCACGGAGCCGGGCGCGCCGCGCTATTCGAGCT
TTCTCGCCAGCTACACGTGGGGCGACGACTCGACGCGGCTGCAGCACAACTTCGGCTACTACCCGCAGAATCCGCCGACG
AGCGACGGAACCGCGACCGCCATGTTCAGGACGATGATCAACCGTGCCACGCGCAACGTGCGGGACCCGGCCGAGCCGGC
GGCCGCGCCGGCCGTCTGGTGGTTTTCGCAACTGCTGAGCCGGGTTCGCGAACAAGACCGCTTCGTGTTCGACTGGACCA
CCAACGGCACGGCCGGCGGCTTCAAGCTCGACGGCACGGGCGATCACCATCAGAGCAATCTCTGCTTCCGGTATCACACG
CATGCGCTCAACCCCAGGCTCGGGAATCGCTTCTTCCTCGCCAGCGATAGCTATAGCCATCTCGGTGGCTGGCTGGAAGG
CGCGTTCATGAGTGCGATCAATGCGGTGGCCGGCCTGGTCGTGGCGGCCAATGGCGGCAATGCGGGGGCACTGAGCAACG
CGGCGCGCGAGGTCGTCACGGGGTTGCGGCCCATCGCGCCGTAG

Upstream 100 bases:

>100_bases
CGCCCCACCCGTCATCGCGTCATGATGGGCAGGATGCCTGCGCCTGCCGGACTGCAGTCCCCCGCTTCATTCACCGCAAC
ATTCACGATGGAGAAGTGCC

Downstream 100 bases:

>100_bases
GCTGCGCGGATGCGGATGATGTGAGCGGATCATCGATGCGCGGGCGTCATTGAAGCCCGCGCATCGATCGAGATACCCGG
CGCCGGATCGCGGCGCCGTT

Product: tryptophan 2-monooxygenase oxidoreductase

Products: indole-3-acetamide; CO2; H2O

Alternate protein names: NA

Number of amino acids: Translated: 707; Mature: 706

Protein sequence:

>707_residues
MGITVMPGLTSMESDTRTQRISTTIGQARLNGRFYRHPDSALVSYPVAVDNALGALPDRAYNIAIVGGGAAGIASLYELS
RLAKTLSAGTMTVTLYESDPDSFLTRLEAGTQAINVRGLKAGRVSAARVNQNDTVYEVGAMRFPEIAGLTWHYASVVYGD
GAPIKVFPNPGKVPTEFMFGDRIDRYSGSAPEDWLDRESPARKVFLVVASGLAGAPDSQTPIALFPIGGRDPVQVAQLLK
SETAGPAQLRAIQERDWPAFIAAHDGTTLEAAVRRIVTREIGKGAASSLPPIAGLDPAETINYYVELFGRFGFGTGGFKP
LFNISLVEMMRLILWDYSNEYTLPVEENVEFIAGLYQKALEQGGSRLTVNVRRERVSDVCHSDAARVRQPFVVAYDRAGK
LSAPNYDYVILAAPQDQLALAVSRSGYAFGPASLVLGDGALGLGTITIRDALPPLLLSDTSSAPNARIVTALNQLHMVRS
SKVFGTIETARLDEPFVPRLKGQPIKAVVSDSGLAASYVVPSPTEPGAPRYSSFLASYTWGDDSTRLQHNFGYYPQNPPT
SDGTATAMFRTMINRATRNVRDPAEPAAAPAVWWFSQLLSRVREQDRFVFDWTTNGTAGGFKLDGTGDHHQSNLCFRYHT
HALNPRLGNRFFLASDSYSHLGGWLEGAFMSAINAVAGLVVAANGGNAGALSNAAREVVTGLRPIAP

Sequences:

>Translated_707_residues
MGITVMPGLTSMESDTRTQRISTTIGQARLNGRFYRHPDSALVSYPVAVDNALGALPDRAYNIAIVGGGAAGIASLYELS
RLAKTLSAGTMTVTLYESDPDSFLTRLEAGTQAINVRGLKAGRVSAARVNQNDTVYEVGAMRFPEIAGLTWHYASVVYGD
GAPIKVFPNPGKVPTEFMFGDRIDRYSGSAPEDWLDRESPARKVFLVVASGLAGAPDSQTPIALFPIGGRDPVQVAQLLK
SETAGPAQLRAIQERDWPAFIAAHDGTTLEAAVRRIVTREIGKGAASSLPPIAGLDPAETINYYVELFGRFGFGTGGFKP
LFNISLVEMMRLILWDYSNEYTLPVEENVEFIAGLYQKALEQGGSRLTVNVRRERVSDVCHSDAARVRQPFVVAYDRAGK
LSAPNYDYVILAAPQDQLALAVSRSGYAFGPASLVLGDGALGLGTITIRDALPPLLLSDTSSAPNARIVTALNQLHMVRS
SKVFGTIETARLDEPFVPRLKGQPIKAVVSDSGLAASYVVPSPTEPGAPRYSSFLASYTWGDDSTRLQHNFGYYPQNPPT
SDGTATAMFRTMINRATRNVRDPAEPAAAPAVWWFSQLLSRVREQDRFVFDWTTNGTAGGFKLDGTGDHHQSNLCFRYHT
HALNPRLGNRFFLASDSYSHLGGWLEGAFMSAINAVAGLVVAANGGNAGALSNAAREVVTGLRPIAP
>Mature_706_residues
GITVMPGLTSMESDTRTQRISTTIGQARLNGRFYRHPDSALVSYPVAVDNALGALPDRAYNIAIVGGGAAGIASLYELSR
LAKTLSAGTMTVTLYESDPDSFLTRLEAGTQAINVRGLKAGRVSAARVNQNDTVYEVGAMRFPEIAGLTWHYASVVYGDG
APIKVFPNPGKVPTEFMFGDRIDRYSGSAPEDWLDRESPARKVFLVVASGLAGAPDSQTPIALFPIGGRDPVQVAQLLKS
ETAGPAQLRAIQERDWPAFIAAHDGTTLEAAVRRIVTREIGKGAASSLPPIAGLDPAETINYYVELFGRFGFGTGGFKPL
FNISLVEMMRLILWDYSNEYTLPVEENVEFIAGLYQKALEQGGSRLTVNVRRERVSDVCHSDAARVRQPFVVAYDRAGKL
SAPNYDYVILAAPQDQLALAVSRSGYAFGPASLVLGDGALGLGTITIRDALPPLLLSDTSSAPNARIVTALNQLHMVRSS
KVFGTIETARLDEPFVPRLKGQPIKAVVSDSGLAASYVVPSPTEPGAPRYSSFLASYTWGDDSTRLQHNFGYYPQNPPTS
DGTATAMFRTMINRATRNVRDPAEPAAAPAVWWFSQLLSRVREQDRFVFDWTTNGTAGGFKLDGTGDHHQSNLCFRYHTH
ALNPRLGNRFFLASDSYSHLGGWLEGAFMSAINAVAGLVVAANGGNAGALSNAAREVVTGLRPIAP

Specific function: Unknown

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: 1.13.12.3

Molecular weight: Translated: 76082; Mature: 75951

Theoretical pI: Translated: 7.40; Mature: 7.40

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.3 %Cys     (Translated Protein)
1.7 %Met     (Translated Protein)
2.0 %Cys+Met (Translated Protein)
0.3 %Cys     (Mature Protein)
1.6 %Met     (Mature Protein)
1.8 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MGITVMPGLTSMESDTRTQRISTTIGQARLNGRFYRHPDSALVSYPVAVDNALGALPDRA
CCEEECCCCCCCCCCHHHHHHHHHHHHHHHCCEEEECCCCCCEEECCHHHHHHHCCCCCC
YNIAIVGGGAAGIASLYELSRLAKTLSAGTMTVTLYESDPDSFLTRLEAGTQAINVRGLK
EEEEEEECCHHHHHHHHHHHHHHHHHCCCEEEEEEECCCHHHHHHHHHCCCEEEEEECCC
AGRVSAARVNQNDTVYEVGAMRFPEIAGLTWHYASVVYGDGAPIKVFPNPGKVPTEFMFG
CCCCEEEEECCCCCEEEECCCCCCHHCCCEEEEEEEEECCCCCEEECCCCCCCCCHHHHC
DRIDRYSGSAPEDWLDRESPARKVFLVVASGLAGAPDSQTPIALFPIGGRDPVQVAQLLK
CCHHHCCCCCCHHHHCCCCCCCEEEEEEECCCCCCCCCCCCEEEEECCCCCHHHHHHHHH
SETAGPAQLRAIQERDWPAFIAAHDGTTLEAAVRRIVTREIGKGAASSLPPIAGLDPAET
HCCCCHHHHHHHHCCCCCEEEEECCCCHHHHHHHHHHHHHHCCCCCCCCCCCCCCCHHHH
INYYVELFGRFGFGTGGFKPLFNISLVEMMRLILWDYSNEYTLPVEENVEFIAGLYQKAL
HHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHCCCCCEECCHHCCHHHHHHHHHHHH
EQGGSRLTVNVRRERVSDVCHSDAARVRQPFVVAYDRAGKLSAPNYDYVILAAPQDQLAL
HCCCCEEEEEEHHHHHHHHHHCCHHHHCCCEEEEECCCCCCCCCCCCEEEEECCCCCEEE
AVSRSGYAFGPASLVLGDGALGLGTITIRDALPPLLLSDTSSAPNARIVTALNQLHMVRS
EEECCCCEECCCEEEEECCCCCEEEEEEHHCCCCEEECCCCCCCCCHHHHHHHHHHHHHC
SKVFGTIETARLDEPFVPRLKGQPIKAVVSDSGLAASYVVPSPTEPGAPRYSSFLASYTW
CCEEEEEEHHCCCCCCCCCCCCCCEEEEECCCCCEEEEECCCCCCCCCCHHHHHHHHEEC
GDDSTRLQHNFGYYPQNPPTSDGTATAMFRTMINRATRNVRDPAEPAAAPAVWWFSQLLS
CCCCCEEECCCCCCCCCCCCCCCHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHH
RVREQDRFVFDWTTNGTAGGFKLDGTGDHHQSNLCFRYHTHALNPRLGNRFFLASDSYSH
HHHHCCCEEEEEECCCCCCCEEECCCCCCCCCCEEEEEECCCCCCCCCCEEEEECCCHHH
LGGWLEGAFMSAINAVAGLVVAANGGNAGALSNAAREVVTGLRPIAP
HHHHHHHHHHHHHHHHEEEEEEECCCCCCHHHHHHHHHHHCCCCCCC
>Mature Secondary Structure 
GITVMPGLTSMESDTRTQRISTTIGQARLNGRFYRHPDSALVSYPVAVDNALGALPDRA
CEEECCCCCCCCCCHHHHHHHHHHHHHHHCCEEEECCCCCCEEECCHHHHHHHCCCCCC
YNIAIVGGGAAGIASLYELSRLAKTLSAGTMTVTLYESDPDSFLTRLEAGTQAINVRGLK
EEEEEEECCHHHHHHHHHHHHHHHHHCCCEEEEEEECCCHHHHHHHHHCCCEEEEEECCC
AGRVSAARVNQNDTVYEVGAMRFPEIAGLTWHYASVVYGDGAPIKVFPNPGKVPTEFMFG
CCCCEEEEECCCCCEEEECCCCCCHHCCCEEEEEEEEECCCCCEEECCCCCCCCCHHHHC
DRIDRYSGSAPEDWLDRESPARKVFLVVASGLAGAPDSQTPIALFPIGGRDPVQVAQLLK
CCHHHCCCCCCHHHHCCCCCCCEEEEEEECCCCCCCCCCCCEEEEECCCCCHHHHHHHHH
SETAGPAQLRAIQERDWPAFIAAHDGTTLEAAVRRIVTREIGKGAASSLPPIAGLDPAET
HCCCCHHHHHHHHCCCCCEEEEECCCCHHHHHHHHHHHHHHCCCCCCCCCCCCCCCHHHH
INYYVELFGRFGFGTGGFKPLFNISLVEMMRLILWDYSNEYTLPVEENVEFIAGLYQKAL
HHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHCCCCCEECCHHCCHHHHHHHHHHHH
EQGGSRLTVNVRRERVSDVCHSDAARVRQPFVVAYDRAGKLSAPNYDYVILAAPQDQLAL
HCCCCEEEEEEHHHHHHHHHHCCHHHHCCCEEEEECCCCCCCCCCCCEEEEECCCCCEEE
AVSRSGYAFGPASLVLGDGALGLGTITIRDALPPLLLSDTSSAPNARIVTALNQLHMVRS
EEECCCCEECCCEEEEECCCCCEEEEEEHHCCCCEEECCCCCCCCCHHHHHHHHHHHHHC
SKVFGTIETARLDEPFVPRLKGQPIKAVVSDSGLAASYVVPSPTEPGAPRYSSFLASYTW
CCEEEEEEHHCCCCCCCCCCCCCCEEEEECCCCCEEEEECCCCCCCCCCHHHHHHHHEEC
GDDSTRLQHNFGYYPQNPPTSDGTATAMFRTMINRATRNVRDPAEPAAAPAVWWFSQLLS
CCCCCEEECCCCCCCCCCCCCCCHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHH
RVREQDRFVFDWTTNGTAGGFKLDGTGDHHQSNLCFRYHTHALNPRLGNRFFLASDSYSH
HHHHCCCEEEEEECCCCCCCEEECCCCCCCCCCEEEEEECCCCCCCCCCEEEEECCCHHH
LGGWLEGAFMSAINAVAGLVVAANGGNAGALSNAAREVVTGLRPIAP
HHHHHHHHHHHHHHHHEEEEEEECCCCCCHHHHHHHHHHHCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: L-tryptophan; O2

Specific reaction: L-tryptophan + O2 = indole-3-acetamide + CO2 + H2O

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA