Definition Burkholderia glumae BGR1 chromosome chromosome 2, complete sequence.
Accession NC_012721
Length 2,827,333

Click here to switch to the map view.

The map label for this gene is degS [H]

Identifier: 238025346

GI number: 238025346

Start: 2510366

End: 2512429

Strand: Direct

Name: degS [H]

Synonym: bglu_2g20220

Alternate gene names: 238025346

Gene position: 2510366-2512429 (Clockwise)

Preceding gene: 238025345

Following gene: 238025347

Centisome position: 88.79

GC content: 72.87

Gene sequence:

>2064_bases
ATGACCCCCTACCGGCTCTCGTCTTTCCTGTCCCGATACCCGCGCGGCTGCGACGCACGAAAACGCGCGGCCGTCTCGCT
GCTGCTGCTCGCCGGCCTGGCGGTGTCGTTCGAGGCCGCCACCCAGATCCACCGGCTCGTGCTCGCGGCCCAGTCGAGCG
CCTTCGAGCAACGCACCGACGCGATCCGCACCTCGCTGCGCCAGCAGATACAGGCGGCCACGGCAATGCTGCTCGGTGTG
CGGCAATGGACGACGGCGCACGCCATGTTGCCGCGGCCCTGGCAATCGGAGGAGCTGGACTTCTCCGATCTCGAGCGCGC
GCATTCGCCGATCCGCCAGTTGCGCTATCTCGACGCCGCCACCGTGTTTGCCCGGCTGGCGCTGCAGGCTGCCCCGGCCG
CGGCCGCGCGACGCCCCGCGTGGTCCGGCCAGCGCCTGCGCGCCAGCCTGCAGCAGGCGATCGCCAGCGACCAGATCGCG
CTCGCGGCGCCATGGTTCGCGGCCGACAGCGCCGCGGCAGCGAATGGCCAAGGCAACCAGCTCGAGTTGTACCTGCCCGT
CTATCGCGACATGAGCCGGCCCGACGGCGCGATCGTGCCGGCCGGCCGCCCGGTCGCGGGCTTCCTGTCGGTGGCGATCG
ACCTGTCCCGCTTCATGGCGATGGCGAACGGCGATCTGCCCGCCGTCGCGCTGCGCGTGTCCGCCGGCCCCGCAGCGCCG
GTCCGCGCGGCCGGCCGGCCCGGCGGCGGCGACTTCCCGAGGCTTCGGCGCACCCTGTCGGCGAGCGTCGCCGGTACCGC
GCTGACGCTCGACTTTTCCGCGGAAGGCCGGCGCGGCGCGCGGCGCGCCGATGCCTTCGCGGCGCTCGTCCTGCTTGCCG
GCTCGGGCTGCACGGCGCTCGCCGGCGTCCTGCTGTTGCGCCTGCCGAATCACGGCCCCGCGCCCGGCCCGCGGCTGCCC
GAGCCGTTGGGCGAGACCCGCCTGATGGGCATCATCCGCGCCTCGTCCGAGGCGATCATCACGATCGACGAATCGCAAAC
CGTGCTGATCTTCAATCCGGCCGCCGAGCGGATCTTCGGTGTCCCGGCGGCCGACGCCATCGGCGGCCCGCTCGCCCGCT
TCCTTCCCGAACGTTGCCGCGCGGCCCACGAACGGCACATCGCAAGGTTCGGCCTCGCCGCTGCCTCGCCGCGGCAGATG
GGGCGACAGCAGCGGCTCTACGGCCTGCGCGCCAACGGCGAGGAATTCCCGCTCGAGGCCTCGATTTCGCAGCTGGGCGA
CGGCGCCGGCCGGATCTGCACCATCGTGCTGCGCGACGTCACCGAGCGCGTGCGCAGCGACAACGCGCTGGAACACGCGC
GTGACGAACTGCGCGCATGGTCCGCGCACCTGCAGCAGGCCGGCGAAGAGGAAAAGACCCGCCTCGCCCGCGAACTGCAC
GACGACCTCGGCCAGCAGCTCGCCGTGCTCGAGATGGAAGCCTCGGCGGCCGCGCAGGCACTCGACCGGGTGCTCGATGG
CGCCCGGGACCCCGGGCTGATCGAGACGGCCGTCAACAAGCTCCATGGCATGCGGCGGCTGACCGATTCGGCGGTGGCGT
CGGTGCGCCGCGTCGCCGCGAATTTGCGGCCCCTGATGCTCGACGATCTCGGCGTGGTGCCCGCCATCGAATGGCTGGCC
AGCGACTTCGCGAAGCGCCACGGCATCGAGGTGGTCCGGCATGTCGCCCTCGGCGAGCGCACGCTCACCGGCGCTGGCGC
AACCGCGCTGTTCCGTATCGTGCAGGAGGCCCTGGTCAATGTCGCCAAGCACGCGCAGGCGAGCCGCGTCGATATCTGCC
TGAAGGCGGTCGGGGACGCCTGCGTGCTGCGCGTCGCCGACAACGGACGCGGCGTGCCGCACGAGCGGCCGCGCGCAGGC
AAGGCCTTCGGGCTGATCGGCGTGCGCGAGCGCGCCCACGCGCTCGGCGGCCGGCTGACGATCGCCGGCCCGCCGGGTCA
GGGCTTTTCGATCACCGTCACGCTGCCGCTGGCCGTGGTGCAGCAGGGAGCGCCAGGCTCATGA

Upstream 100 bases:

>100_bases
GGTGGTCCGCGGCGAGGCCGGCCCATGCTGCGCAGGGCCGTGCCGCCCGCCGCGCCTTCCGCCCGACCTCGACGCCGCCT
GCGGCCGGCCCGATCGCCCC

Downstream 100 bases:

>100_bases
TCGAGGTGCTTCTCGCGGACGACCACGCCATGGTGCGCGACGGCTTGCGCTACATCCTGCAGAACACCAGCGGCTTCCAG
GTGGCGGGCGAGGCGGCGGA

Product: Sensory box histidine kinase

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 687; Mature: 686

Protein sequence:

>687_residues
MTPYRLSSFLSRYPRGCDARKRAAVSLLLLAGLAVSFEAATQIHRLVLAAQSSAFEQRTDAIRTSLRQQIQAATAMLLGV
RQWTTAHAMLPRPWQSEELDFSDLERAHSPIRQLRYLDAATVFARLALQAAPAAAARRPAWSGQRLRASLQQAIASDQIA
LAAPWFAADSAAAANGQGNQLELYLPVYRDMSRPDGAIVPAGRPVAGFLSVAIDLSRFMAMANGDLPAVALRVSAGPAAP
VRAAGRPGGGDFPRLRRTLSASVAGTALTLDFSAEGRRGARRADAFAALVLLAGSGCTALAGVLLLRLPNHGPAPGPRLP
EPLGETRLMGIIRASSEAIITIDESQTVLIFNPAAERIFGVPAADAIGGPLARFLPERCRAAHERHIARFGLAAASPRQM
GRQQRLYGLRANGEEFPLEASISQLGDGAGRICTIVLRDVTERVRSDNALEHARDELRAWSAHLQQAGEEEKTRLARELH
DDLGQQLAVLEMEASAAAQALDRVLDGARDPGLIETAVNKLHGMRRLTDSAVASVRRVAANLRPLMLDDLGVVPAIEWLA
SDFAKRHGIEVVRHVALGERTLTGAGATALFRIVQEALVNVAKHAQASRVDICLKAVGDACVLRVADNGRGVPHERPRAG
KAFGLIGVRERAHALGGRLTIAGPPGQGFSITVTLPLAVVQQGAPGS

Sequences:

>Translated_687_residues
MTPYRLSSFLSRYPRGCDARKRAAVSLLLLAGLAVSFEAATQIHRLVLAAQSSAFEQRTDAIRTSLRQQIQAATAMLLGV
RQWTTAHAMLPRPWQSEELDFSDLERAHSPIRQLRYLDAATVFARLALQAAPAAAARRPAWSGQRLRASLQQAIASDQIA
LAAPWFAADSAAAANGQGNQLELYLPVYRDMSRPDGAIVPAGRPVAGFLSVAIDLSRFMAMANGDLPAVALRVSAGPAAP
VRAAGRPGGGDFPRLRRTLSASVAGTALTLDFSAEGRRGARRADAFAALVLLAGSGCTALAGVLLLRLPNHGPAPGPRLP
EPLGETRLMGIIRASSEAIITIDESQTVLIFNPAAERIFGVPAADAIGGPLARFLPERCRAAHERHIARFGLAAASPRQM
GRQQRLYGLRANGEEFPLEASISQLGDGAGRICTIVLRDVTERVRSDNALEHARDELRAWSAHLQQAGEEEKTRLARELH
DDLGQQLAVLEMEASAAAQALDRVLDGARDPGLIETAVNKLHGMRRLTDSAVASVRRVAANLRPLMLDDLGVVPAIEWLA
SDFAKRHGIEVVRHVALGERTLTGAGATALFRIVQEALVNVAKHAQASRVDICLKAVGDACVLRVADNGRGVPHERPRAG
KAFGLIGVRERAHALGGRLTIAGPPGQGFSITVTLPLAVVQQGAPGS
>Mature_686_residues
TPYRLSSFLSRYPRGCDARKRAAVSLLLLAGLAVSFEAATQIHRLVLAAQSSAFEQRTDAIRTSLRQQIQAATAMLLGVR
QWTTAHAMLPRPWQSEELDFSDLERAHSPIRQLRYLDAATVFARLALQAAPAAAARRPAWSGQRLRASLQQAIASDQIAL
AAPWFAADSAAAANGQGNQLELYLPVYRDMSRPDGAIVPAGRPVAGFLSVAIDLSRFMAMANGDLPAVALRVSAGPAAPV
RAAGRPGGGDFPRLRRTLSASVAGTALTLDFSAEGRRGARRADAFAALVLLAGSGCTALAGVLLLRLPNHGPAPGPRLPE
PLGETRLMGIIRASSEAIITIDESQTVLIFNPAAERIFGVPAADAIGGPLARFLPERCRAAHERHIARFGLAAASPRQMG
RQQRLYGLRANGEEFPLEASISQLGDGAGRICTIVLRDVTERVRSDNALEHARDELRAWSAHLQQAGEEEKTRLARELHD
DLGQQLAVLEMEASAAAQALDRVLDGARDPGLIETAVNKLHGMRRLTDSAVASVRRVAANLRPLMLDDLGVVPAIEWLAS
DFAKRHGIEVVRHVALGERTLTGAGATALFRIVQEALVNVAKHAQASRVDICLKAVGDACVLRVADNGRGVPHERPRAGK
AFGLIGVRERAHALGGRLTIAGPPGQGFSITVTLPLAVVQQGAPGS

Specific function: Involved in a sensory transduction pathway that affect the production of enzymes that degrade polymeric carbon and nitrogen sources. DegS probably acts as a kinase that phosphorylates degU [H]

COG id: COG4585

COG function: function code T; Signal transduction histidine kinase

Gene ontology:

Cell location: Integral Membrane Protein. Inner Membrane [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 histidine kinase domain [H]

Homologues:

Organism=Escherichia coli, GI1787474, Length=206, Percent_Identity=30.0970873786408, Blast_Score=84, Evalue=2e-17,
Organism=Escherichia coli, GI87082311, Length=212, Percent_Identity=33.9622641509434, Blast_Score=70, Evalue=4e-13,
Organism=Escherichia coli, GI1788812, Length=215, Percent_Identity=26.9767441860465, Blast_Score=67, Evalue=4e-12,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR003594
- InterPro:   IPR008595
- InterPro:   IPR011712
- InterPro:   IPR005467
- InterPro:   IPR016381 [H]

Pfam domain/function: PF05384 DegS; PF02518 HATPase_c; PF07730 HisKA_3 [H]

EC number: =2.7.13.3 [H]

Molecular weight: Translated: 73123; Mature: 72992

Theoretical pI: Translated: 10.70; Mature: 10.70

Prosite motif: PS50112 PAS ; PS50109 HIS_KIN

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.9 %Cys     (Translated Protein)
1.6 %Met     (Translated Protein)
2.5 %Cys+Met (Translated Protein)
0.9 %Cys     (Mature Protein)
1.5 %Met     (Mature Protein)
2.3 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MTPYRLSSFLSRYPRGCDARKRAAVSLLLLAGLAVSFEAATQIHRLVLAAQSSAFEQRTD
CCCHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
AIRTSLRQQIQAATAMLLGVRQWTTAHAMLPRPWQSEELDFSDLERAHSPIRQLRYLDAA
HHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHH
TVFARLALQAAPAAAARRPAWSGQRLRASLQQAIASDQIALAAPWFAADSAAAANGQGNQ
HHHHHHHHHHCCHHHHCCCCCCCHHHHHHHHHHHHCCCEEEECCCCCCCCCCCCCCCCCE
LELYLPVYRDMSRPDGAIVPAGRPVAGFLSVAIDLSRFMAMANGDLPAVALRVSAGPAAP
EEEEEEHHHCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHCCCCCCEEEEEECCCCCCC
VRAAGRPGGGDFPRLRRTLSASVAGTALTLDFSAEGRRGARRADAFAALVLLAGSGCTAL
CCCCCCCCCCCHHHHHHHHHHHHCCEEEEEEECCCCCCCCHHHHHHHHHHHHCCCCHHHH
AGVLLLRLPNHGPAPGPRLPEPLGETRLMGIIRASSEAIITIDESQTVLIFNPAAERIFG
HHHHHHCCCCCCCCCCCCCCCCCCHHHHHHHEECCCCEEEEECCCCEEEEECCHHHHHCC
VPAADAIGGPLARFLPERCRAAHERHIARFGLAAASPRQMGRQQRLYGLRANGEEFPLEA
CCCHHHCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHCHHHHHHEECCCCCCCCCHH
SISQLGDGAGRICTIVLRDVTERVRSDNALEHARDELRAWSAHLQQAGEEEKTRLARELH
HHHHCCCCCHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHH
DDLGQQLAVLEMEASAAAQALDRVLDGARDPGLIETAVNKLHGMRRLTDSAVASVRRVAA
HHHHHHEEHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHH
NLRPLMLDDLGVVPAIEWLASDFAKRHGIEVVRHVALGERTLTGAGATALFRIVQEALVN
CCCCHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCCEECCCCHHHHHHHHHHHHHH
VAKHAQASRVDICLKAVGDACVLRVADNGRGVPHERPRAGKAFGLIGVRERAHALGGRLT
HHHHCCHHHHHHHHHHCCCEEEEEECCCCCCCCCCCCCCCCCCCCHHHHHHHHHCCCEEE
IAGPPGQGFSITVTLPLAVVQQGAPGS
EECCCCCCEEEEEEEHHHHHCCCCCCC
>Mature Secondary Structure 
TPYRLSSFLSRYPRGCDARKRAAVSLLLLAGLAVSFEAATQIHRLVLAAQSSAFEQRTD
CCHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
AIRTSLRQQIQAATAMLLGVRQWTTAHAMLPRPWQSEELDFSDLERAHSPIRQLRYLDAA
HHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHH
TVFARLALQAAPAAAARRPAWSGQRLRASLQQAIASDQIALAAPWFAADSAAAANGQGNQ
HHHHHHHHHHCCHHHHCCCCCCCHHHHHHHHHHHHCCCEEEECCCCCCCCCCCCCCCCCE
LELYLPVYRDMSRPDGAIVPAGRPVAGFLSVAIDLSRFMAMANGDLPAVALRVSAGPAAP
EEEEEEHHHCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHHCCCCCCEEEEEECCCCCCC
VRAAGRPGGGDFPRLRRTLSASVAGTALTLDFSAEGRRGARRADAFAALVLLAGSGCTAL
CCCCCCCCCCCHHHHHHHHHHHHCCEEEEEEECCCCCCCCHHHHHHHHHHHHCCCCHHHH
AGVLLLRLPNHGPAPGPRLPEPLGETRLMGIIRASSEAIITIDESQTVLIFNPAAERIFG
HHHHHHCCCCCCCCCCCCCCCCCCHHHHHHHEECCCCEEEEECCCCEEEEECCHHHHHCC
VPAADAIGGPLARFLPERCRAAHERHIARFGLAAASPRQMGRQQRLYGLRANGEEFPLEA
CCCHHHCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHCHHHHHHEECCCCCCCCCHH
SISQLGDGAGRICTIVLRDVTERVRSDNALEHARDELRAWSAHLQQAGEEEKTRLARELH
HHHHCCCCCHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHH
DDLGQQLAVLEMEASAAAQALDRVLDGARDPGLIETAVNKLHGMRRLTDSAVASVRRVAA
HHHHHHEEHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHH
NLRPLMLDDLGVVPAIEWLASDFAKRHGIEVVRHVALGERTLTGAGATALFRIVQEALVN
CCCCHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCCEECCCCHHHHHHHHHHHHHH
VAKHAQASRVDICLKAVGDACVLRVADNGRGVPHERPRAGKAFGLIGVRERAHALGGRLT
HHHHCCHHHHHHHHHHCCCEEEEEECCCCCCCCCCCCCCCCCCCCHHHHHHHHHCCCEEE
IAGPPGQGFSITVTLPLAVVQQGAPGS
EECCCCCCEEEEEEEHHHHHCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 7765823 [H]