Definition Bradyrhizobium sp. ORS278 chromosome, complete genome.
Accession NC_009445
Length 7,456,587

Click here to switch to the map view.

The map label for this gene is yegE [C]

Identifier: 146340401

GI number: 146340401

Start: 3618589

End: 3620697

Strand: Reverse

Name: yegE [C]

Synonym: BRADO3434

Alternate gene names: 146340401

Gene position: 3620697-3618589 (Counterclockwise)

Preceding gene: 146340402

Following gene: 146340400

Centisome position: 48.56

GC content: 67.33

Gene sequence:

>2109_bases
TTGCGCCAGGCCTGCCGGCTCGGGCATGGTACCGGAGAAACGGCAATGGTCGAACAGCGTATGGGCGAAGGAACGTTCGA
ACGGGAGATCGTGCAGCGACTCGGGCTGATGCCCAATCTGTTCCGTCCGCCGCCTGCGGCGCCGGAGGCGACGCGACAGC
TGTGGCAGCTCGCGACCTGCGCCTATCTCGACGCCCCGTTGCCGGCGCTATTCAAGGAGCGGCTCGCCGTCCATCTCTCG
CGCCTCGCCTGCTCCGCCTATTGCCTGGCGCGGCATTTCGGCTTCCTGATCGGGCTTGGCCGTCCCGCGGGCGATCCAAC
GTGCCCTCCGGAGACGATCGACGAGGCACGGCAGCTGCTGTCGCTGCCGCTCGCCGATCCTGATCACGTCGCCGCGGCGC
TCGACCGGCTCGAGGCGGTGCAGACGCCGCGCGCGATCCCGGAGCCGCGCAGCGAGAGCGAAGCCGATTTGTTTGCTGCG
GCCGCAGCGCTGTTTCAGCCGAATGCCGCCGCCGCCCGCGCACGGCTAGCGATCCGTCACGCCTTCGGCGACACGACGTT
CGAGCTGCTCGCGGGCTTCCTGGCGTATCTGCGCATGGCGCATTTCTGGGCCGAGGCGCATCCCGAGCTCCCGATGGATT
CCGATCTGCGCATGCTGATGCAAGCGGATCCCGAGCTCGCCGCGCTGCTGAGCTGCCGTGAGCCGGTCCCTCTTGTCCCC
GCGATGGCCACGGCTTCCAGCAGCGGCGCGAGCGCGCATCGGCTGGGCCGCCTGCTGGAGATCGACTCGGTCGGCGTGCT
GTTCTTTGATCATGCCGAGGGCACCCTGCTCGACGCCAACGATGCCTTCCTCGATATGACAGGTTATTCGCGCGAGGAGG
TGCGCAGCCGTCGGCTCACATGGCAGAGCCTAACGCCGCCGGAATGGGTTGAGGCCTCGACCTCGCAGATCTCGCATCTG
AAGCGCACAGGACGGATCGGTCCCTATGAGAAGGAATACTTCCGCAAGAACGGAGAGCGCGCCTGGATGATGTTCGCCGG
CCGCGACCTCGGCGACGGCACGCTAGTCGAGCTGGCGATGAATATCGACGACCGCAAGCGGACCGAAGCCGCGCTGCGCG
ACAGCGAAGCGCGATTCCGCCAGTTCGGCGAGGCCTCGTCCGACGTGCTGTGGATCCGCAATTCCTGCACCATGCATTGG
GAATATCTCAGCCCCGCATTCGAGACGATCTACGGCGTGCCGCGCACCGCCGTCATGCAGGGCGATCATCTCACGCCGTG
GATCGAGCTGATGGTGCCGGAGGATCGCGCGCGGGCTCTCGAGGGTCTCGAGCGCGCCCGGCGGGGCGAGCGCGACAGCT
TCGATTTCCGCATCGTCAGGCAGACCGACGGCGCACAGCGCTGGCTGCGCATCCGGAGTTTTCCGATGGTCGACGACTCA
GGGCAGGTGCAGCGCATCGGCGGCATCACGCAGGACATCACGGCGCTGATCGAGGCGGCAGATCATCAGAAATTCCTGCT
CGCCGAGTTGCAGCACCGGGTGCGCAACATGCTTGCGGTGATCCGCTCCATCATCCGGCGCACCGGTGAATCCAGCGAGA
GCGCCGAGGATTTCGCGAGCCACCTCGAGGGCCGCATCGCCGCGCTGTCGCGCATCCAGGCCGTCGTCACGCGGGATCCG
CTCGCCGGCTTCGATCTGACCGAGCTGATTGCCGACGAGCTGCGCGCCGGCGCCGCGCGCGAGGATCGGCAGTACTCGCT
GTCCGGGCCCGCGGTGCGGATCAAGGCGAAGGCGGCCGAGAGCATCGGTCTTGCGATGCATGAGCTCGCCACCAACGCGC
TGAAGTTCGGGGCTCTGACAGTCCCGCGCGGATTCATCGATATCGCGTGGCGCTTGGACGAGCGCGACGCGGTCCGCTGG
CTCGTGATCGACTGGATCGAGACCGGCCTGTCCGGCCGCGTCATCGGCCCGAGCCGACATGGCTTCGGCACCGTCCTGCT
CGAGCAGATGCTGCCTTATGAGGTCGGCGCGCGAGTTATCCGCCGCTTCGAGCCGAGCGGGCTCCGTTGCGAGATCCGGC
TGCCGGCCGACGATATCCTCAAGAACTGA

Upstream 100 bases:

>100_bases
GAGCGCTGGCCTGTTCAATGCCAATTATCTGCATCTCGACCGTGAAGGTCGCCAGCTCGACGCGAACGAGTGAGAGATTC
CTGCGCCGAGGGCATGCGAC

Downstream 100 bases:

>100_bases
GCGATCGGCAAAAATGGCAGAGTCCGCCAAATACCATCCGGCATAGCCTTCGCCGTTGGTTCAGAGTATGCTCGCGCCTG
TGATCAACCTCACGGCCGCG

Product: histidine kinase

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 702; Mature: 702

Protein sequence:

>702_residues
MRQACRLGHGTGETAMVEQRMGEGTFEREIVQRLGLMPNLFRPPPAAPEATRQLWQLATCAYLDAPLPALFKERLAVHLS
RLACSAYCLARHFGFLIGLGRPAGDPTCPPETIDEARQLLSLPLADPDHVAAALDRLEAVQTPRAIPEPRSESEADLFAA
AAALFQPNAAAARARLAIRHAFGDTTFELLAGFLAYLRMAHFWAEAHPELPMDSDLRMLMQADPELAALLSCREPVPLVP
AMATASSSGASAHRLGRLLEIDSVGVLFFDHAEGTLLDANDAFLDMTGYSREEVRSRRLTWQSLTPPEWVEASTSQISHL
KRTGRIGPYEKEYFRKNGERAWMMFAGRDLGDGTLVELAMNIDDRKRTEAALRDSEARFRQFGEASSDVLWIRNSCTMHW
EYLSPAFETIYGVPRTAVMQGDHLTPWIELMVPEDRARALEGLERARRGERDSFDFRIVRQTDGAQRWLRIRSFPMVDDS
GQVQRIGGITQDITALIEAADHQKFLLAELQHRVRNMLAVIRSIIRRTGESSESAEDFASHLEGRIAALSRIQAVVTRDP
LAGFDLTELIADELRAGAAREDRQYSLSGPAVRIKAKAAESIGLAMHELATNALKFGALTVPRGFIDIAWRLDERDAVRW
LVIDWIETGLSGRVIGPSRHGFGTVLLEQMLPYEVGARVIRRFEPSGLRCEIRLPADDILKN

Sequences:

>Translated_702_residues
MRQACRLGHGTGETAMVEQRMGEGTFEREIVQRLGLMPNLFRPPPAAPEATRQLWQLATCAYLDAPLPALFKERLAVHLS
RLACSAYCLARHFGFLIGLGRPAGDPTCPPETIDEARQLLSLPLADPDHVAAALDRLEAVQTPRAIPEPRSESEADLFAA
AAALFQPNAAAARARLAIRHAFGDTTFELLAGFLAYLRMAHFWAEAHPELPMDSDLRMLMQADPELAALLSCREPVPLVP
AMATASSSGASAHRLGRLLEIDSVGVLFFDHAEGTLLDANDAFLDMTGYSREEVRSRRLTWQSLTPPEWVEASTSQISHL
KRTGRIGPYEKEYFRKNGERAWMMFAGRDLGDGTLVELAMNIDDRKRTEAALRDSEARFRQFGEASSDVLWIRNSCTMHW
EYLSPAFETIYGVPRTAVMQGDHLTPWIELMVPEDRARALEGLERARRGERDSFDFRIVRQTDGAQRWLRIRSFPMVDDS
GQVQRIGGITQDITALIEAADHQKFLLAELQHRVRNMLAVIRSIIRRTGESSESAEDFASHLEGRIAALSRIQAVVTRDP
LAGFDLTELIADELRAGAAREDRQYSLSGPAVRIKAKAAESIGLAMHELATNALKFGALTVPRGFIDIAWRLDERDAVRW
LVIDWIETGLSGRVIGPSRHGFGTVLLEQMLPYEVGARVIRRFEPSGLRCEIRLPADDILKN
>Mature_702_residues
MRQACRLGHGTGETAMVEQRMGEGTFEREIVQRLGLMPNLFRPPPAAPEATRQLWQLATCAYLDAPLPALFKERLAVHLS
RLACSAYCLARHFGFLIGLGRPAGDPTCPPETIDEARQLLSLPLADPDHVAAALDRLEAVQTPRAIPEPRSESEADLFAA
AAALFQPNAAAARARLAIRHAFGDTTFELLAGFLAYLRMAHFWAEAHPELPMDSDLRMLMQADPELAALLSCREPVPLVP
AMATASSSGASAHRLGRLLEIDSVGVLFFDHAEGTLLDANDAFLDMTGYSREEVRSRRLTWQSLTPPEWVEASTSQISHL
KRTGRIGPYEKEYFRKNGERAWMMFAGRDLGDGTLVELAMNIDDRKRTEAALRDSEARFRQFGEASSDVLWIRNSCTMHW
EYLSPAFETIYGVPRTAVMQGDHLTPWIELMVPEDRARALEGLERARRGERDSFDFRIVRQTDGAQRWLRIRSFPMVDDS
GQVQRIGGITQDITALIEAADHQKFLLAELQHRVRNMLAVIRSIIRRTGESSESAEDFASHLEGRIAALSRIQAVVTRDP
LAGFDLTELIADELRAGAAREDRQYSLSGPAVRIKAKAAESIGLAMHELATNALKFGALTVPRGFIDIAWRLDERDAVRW
LVIDWIETGLSGRVIGPSRHGFGTVLLEQMLPYEVGARVIRRFEPSGLRCEIRLPADDILKN

Specific function: Photosensitive kinase that is involved in increased bacterial virulence upon exposure to light. Once ejected from an infected animal host, sunlight acts as an environmental signal that increases the virulence of the bacterium, preparing it for infection o

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 PAS (PER-ARNT-SIM) domain [H]

Homologues:

Organism=Escherichia coli, GI1788381, Length=255, Percent_Identity=30.1960784313725, Blast_Score=78, Evalue=2e-15,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR001610
- InterPro:   IPR000014
- InterPro:   IPR000700
- InterPro:   IPR013767
- InterPro:   IPR013655
- InterPro:   IPR011102 [H]

Pfam domain/function: PF07536 HWE_HK; PF00989 PAS; PF08447 PAS_3 [H]

EC number: =2.7.13.3 [H]

Molecular weight: Translated: 78254; Mature: 78254

Theoretical pI: Translated: 6.09; Mature: 6.09

Prosite motif: PS50112 PAS ; PS50113 PAC

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.1 %Cys     (Translated Protein)
2.8 %Met     (Translated Protein)
4.0 %Cys+Met (Translated Protein)
1.1 %Cys     (Mature Protein)
2.8 %Met     (Mature Protein)
4.0 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MRQACRLGHGTGETAMVEQRMGEGTFEREIVQRLGLMPNLFRPPPAAPEATRQLWQLATC
CCCCCCCCCCCCCHHHHHHHHCCCHHHHHHHHHHCCCCCCCCCCCCCCHHHHHHHHHHHH
AYLDAPLPALFKERLAVHLSRLACSAYCLARHFGFLIGLGRPAGDPTCPPETIDEARQLL
HHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHEECCCCCCCCCCCHHHHHHHHHHH
SLPLADPDHVAAALDRLEAVQTPRAIPEPRSESEADLFAAAAALFQPNAAAARARLAIRH
HCCCCCHHHHHHHHHHHHHHHCCCCCCCCCCCCHHHHHHHHHHHHCCCHHHHHHHHHHHH
AFGDTTFELLAGFLAYLRMAHFWAEAHPELPMDSDLRMLMQADPELAALLSCREPVPLVP
HHCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHCCHHHHHHHHCCCCCCCCC
AMATASSSGASAHRLGRLLEIDSVGVLFFDHAEGTLLDANDAFLDMTGYSREEVRSRRLT
HHHHCCCCCCCHHHHHHHHEECCCCEEEEECCCCCEEECCCCEEECCCCCHHHHHHHHCC
WQSLTPPEWVEASTSQISHLKRTGRIGPYEKEYFRKNGERAWMMFAGRDLGDGTLVELAM
CCCCCCHHHHHHHHHHHHHHHHHCCCCCCHHHHHHCCCCEEEEEEECCCCCCCCEEEEEE
NIDDRKRTEAALRDSEARFRQFGEASSDVLWIRNSCTMHWEYLSPAFETIYGVPRTAVMQ
CCCHHHHHHHHHHHHHHHHHHHCCCCCCEEEEECCCEEEHHHHHHHHHHHHCCCCCEEEC
GDHLTPWIELMVPEDRARALEGLERARRGERDSFDFRIVRQTDGAQRWLRIRSFPMVDDS
CCCCCCEEEEECCCHHHHHHHHHHHHHCCCCCCCCEEEEECCCCHHHHHHHHCCCCCCCC
GQVQRIGGITQDITALIEAADHQKFLLAELQHRVRNMLAVIRSIIRRTGESSESAEDFAS
CCCHHHCCCHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHH
HLEGRIAALSRIQAVVTRDPLAGFDLTELIADELRAGAAREDRQYSLSGPAVRIKAKAAE
HHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHCCCCCCCCCEECCCCEEEEEEHHHH
SIGLAMHELATNALKFGALTVPRGFIDIAWRLDERDAVRWLVIDWIETGLSGRVIGPSRH
HHHHHHHHHHHHHHHHCCEECCCCCEEEEEEECCCCCHHHHHHHHHHCCCCCEEECCCCC
GFGTVLLEQMLPYEVGARVIRRFEPSGLRCEIRLPADDILKN
CHHHHHHHHHCCHHHHHHHHHHCCCCCCEEEEECCHHHHHCC
>Mature Secondary Structure
MRQACRLGHGTGETAMVEQRMGEGTFEREIVQRLGLMPNLFRPPPAAPEATRQLWQLATC
CCCCCCCCCCCCCHHHHHHHHCCCHHHHHHHHHHCCCCCCCCCCCCCCHHHHHHHHHHHH
AYLDAPLPALFKERLAVHLSRLACSAYCLARHFGFLIGLGRPAGDPTCPPETIDEARQLL
HHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHEECCCCCCCCCCCHHHHHHHHHHH
SLPLADPDHVAAALDRLEAVQTPRAIPEPRSESEADLFAAAAALFQPNAAAARARLAIRH
HCCCCCHHHHHHHHHHHHHHHCCCCCCCCCCCCHHHHHHHHHHHHCCCHHHHHHHHHHHH
AFGDTTFELLAGFLAYLRMAHFWAEAHPELPMDSDLRMLMQADPELAALLSCREPVPLVP
HHCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHCCHHHHHHHHCCCCCCCCC
AMATASSSGASAHRLGRLLEIDSVGVLFFDHAEGTLLDANDAFLDMTGYSREEVRSRRLT
HHHHCCCCCCCHHHHHHHHEECCCCEEEEECCCCCEEECCCCEEECCCCCHHHHHHHHCC
WQSLTPPEWVEASTSQISHLKRTGRIGPYEKEYFRKNGERAWMMFAGRDLGDGTLVELAM
CCCCCCHHHHHHHHHHHHHHHHHCCCCCCHHHHHHCCCCEEEEEEECCCCCCCCEEEEEE
NIDDRKRTEAALRDSEARFRQFGEASSDVLWIRNSCTMHWEYLSPAFETIYGVPRTAVMQ
CCCHHHHHHHHHHHHHHHHHHHCCCCCCEEEEECCCEEEHHHHHHHHHHHHCCCCCEEEC
GDHLTPWIELMVPEDRARALEGLERARRGERDSFDFRIVRQTDGAQRWLRIRSFPMVDDS
CCCCCCEEEEECCCHHHHHHHHHHHHHCCCCCCCCEEEEECCCCHHHHHHHHCCCCCCCC
GQVQRIGGITQDITALIEAADHQKFLLAELQHRVRNMLAVIRSIIRRTGESSESAEDFAS
CCCHHHCCCHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHH
HLEGRIAALSRIQAVVTRDPLAGFDLTELIADELRAGAAREDRQYSLSGPAVRIKAKAAE
HHHHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHCCCCCCCCCEECCCCEEEEEEHHHH
SIGLAMHELATNALKFGALTVPRGFIDIAWRLDERDAVRWLVIDWIETGLSGRVIGPSRH
HHHHHHHHHHHHHHHHCCEECCCCCEEEEEEECCCCCHHHHHHHHHHCCCCCEEECCCCC
GFGTVLLEQMLPYEVGARVIRRFEPSGLRCEIRLPADDILKN
CHHHHHHHHHCCHHHHHHHHHHCCCCCCEEEEECCHHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA