Definition Burkholderia mallei NCTC 10247 chromosome II, complete genome.
Accession NC_009079
Length 2,352,693

Click here to switch to the map view.

The map label for this gene is virA [H]

Identifier: 126446436

GI number: 126446436

Start: 1608355

End: 1610199

Strand: Reverse

Name: virA [H]

Synonym: BMA10247_A1670

Alternate gene names: 126446436

Gene position: 1610199-1608355 (Counterclockwise)

Preceding gene: 126447268

Following gene: 126447328

Centisome position: 68.44

GC content: 72.95

Gene sequence:

>1845_bases
ATGCACGGAAATTCCATCGATGCCGGGCCGCCCGCGCGCGCCCGGCCCGCACGCATCACGCGAACGGCGCGCACCGCGCC
GCGCCGCGACGATCGCGCGTTCGCGCCGGGCGGCGCGCTGAACGCGGCGGGGCTGCTGCTGCTGCTGTTCTACGCGAATC
ATCTGCTGTCCCGGCCCGGCGCGTGCACGTCGCTCAATCACACGCTGTCGGCCGTCGTGTGGCCCGCGCCGGTGCTCGGC
ATCGCGCTGCTGCTGCACTGCCGGCGGCCGCTCGCATGGTGGCTCGGCGCGGGTTCGCTGTTCGCCACGCTGCTCGCCGC
GGGCTCGCTCGACTGGGTGCCGTGGCACGTCGACGCGCTGTTCGCGGCCGTCAACGTCGTCGAGGCGATCGCGGGCGCGT
GGCTCGCGCGGCGCTATCTGATCGCGGGCGGCGGGGTGGACACGCTGCGCGGCTTCGCGATGTTCGTGCTGCTGCTGCCG
CTCGGCATGGCGGCGATGCACGCGACGCTCGCGGCGGCGATCCTGTCGGTATGGATGAACGACCGCGAATGGCTGAGCGA
ATGGTCGCGCGCGTATGCGGCGAACGCGCTCGCGCTGCTCGTGCTGCTGCCGGCGCTCCTCACGTGGAACGCGCGCGCAT
GCGGCGCGGCGTGGTCGCGCAGCCGCAATCAGTTGCCGGTGCTCGCGACGTTCGGCTCGCTGTGCTTCGCGTCGATATGG
GGATACCAGGCCGAGGTCGCGCGCGCGCTGCTCGCGCTGTCGCTGAGCTGGGCCGCGCTCGAGGGCGGCCTCGTGCTCGC
GTCCCAGCTCAACGCGCTCTCGGCGATCGCCCTGATCGCGATGACGCTCGGCGGGCGCGGCCCGTATGCGTGGCATCACG
ACGGCCACGGCGTCTGGGCGCTGCAGGTCGATCTGATCGGCGTCGCGATCCTGTCGATGTGCATCGCGATCGCGACGGGC
GAGCGGCGGCGGCTTGCGCGGCAGATCGAACGATCGCGCCGTTTCGAGTCGCTCGGCTTTTTCGCCGGCGGAATCGTGCA
CGATTTCAGCAACGTGCTGACGACGATCGATTGCCACGCCGAATACGCGTCCGAGCGGCTCGCGAGCGGCGCGCGCGCGG
ACGATTCGATCGACGAGATTCATCGCGCGGTCGAACGCGGCCGCGATCTGGCGGCGCAGATCCTGCTCGCCGCGCGCCGC
GGCGAGCCCGTGCTGACGCGGGTGAGCGTCGACGAGGTCGTCGACGAGGCGCTCGCCGCGACACGCGCGGCCGCGTGGCG
CGGCGTCGAGATCGTTCGATGCGGCGATGGCGCGCGCGACGGCGCCCGGCGTGGCGACGTTCGTCACGTCGTATTCGCCG
ATCGCAGCCAGCTCGCGCGCGCGGTCATGAATCTCGTCGGCAATGCGGTGCGCGCGGCGCGCGCGACGGTTGTCGTGCGT
GTCGGGGTGAACGGCGGGGTGAATGGCGGCGCGAGCGATGGGGCGAGCCGCGGCGCGAACGACGGCGGCGCGCCGGCCGC
TCGCGCATTCGACGTCGCGATCGGCGAAGCGGCGATGCCGGGCGGCGTGTGGATCGAGGTGAGCGACGACGGCGAAGGCA
TCGACGTCGAGCCGCTCGACCGCATCTTCGAGCCGTTCTATTCGAACCGCTCCGGCGCGCCGGGGACGGGGCTGGGTCTC
GCGATCGTCGCGGGCGCGGCGCTCGCGCACCGCGGGCAGATCGCCGTCGCGACGGATCGGGGCGCGGGCAGTTGCTTCCG
GCTCACGTTGCCGGCGGCATGGGGAACGGGCGCGCCCGGCGCAATGGACGCCGGCGCGCCCGGCGCAGTACAGGAGAGGA
CATGA

Upstream 100 bases:

>100_bases
GCCGCCTTCGTTGCGGATGAAAAGAACCGTGCGGCGCATCGCTAAGATCGATTGATGTCCGAAACAAAGACGGTTTAGTA
TTCGCCGACCTCTGAGACCT

Downstream 100 bases:

>100_bases
CGAATGTGACAAGATCGCCGGCGGTGCTCGTCGTCGAGGACGACGAACCGTTGCGGCGCGTGCTTTGCAATTACCTGTCG
GGCCACGGGATGGCCGTGGA

Product: sensor histidine kinase

Products: NA

Alternate protein names: WHR virA [H]

Number of amino acids: Translated: 614; Mature: 614

Protein sequence:

>614_residues
MHGNSIDAGPPARARPARITRTARTAPRRDDRAFAPGGALNAAGLLLLLFYANHLLSRPGACTSLNHTLSAVVWPAPVLG
IALLLHCRRPLAWWLGAGSLFATLLAAGSLDWVPWHVDALFAAVNVVEAIAGAWLARRYLIAGGGVDTLRGFAMFVLLLP
LGMAAMHATLAAAILSVWMNDREWLSEWSRAYAANALALLVLLPALLTWNARACGAAWSRSRNQLPVLATFGSLCFASIW
GYQAEVARALLALSLSWAALEGGLVLASQLNALSAIALIAMTLGGRGPYAWHHDGHGVWALQVDLIGVAILSMCIAIATG
ERRRLARQIERSRRFESLGFFAGGIVHDFSNVLTTIDCHAEYASERLASGARADDSIDEIHRAVERGRDLAAQILLAARR
GEPVLTRVSVDEVVDEALAATRAAAWRGVEIVRCGDGARDGARRGDVRHVVFADRSQLARAVMNLVGNAVRAARATVVVR
VGVNGGVNGGASDGASRGANDGGAPAARAFDVAIGEAAMPGGVWIEVSDDGEGIDVEPLDRIFEPFYSNRSGAPGTGLGL
AIVAGAALAHRGQIAVATDRGAGSCFRLTLPAAWGTGAPGAMDAGAPGAVQERT

Sequences:

>Translated_614_residues
MHGNSIDAGPPARARPARITRTARTAPRRDDRAFAPGGALNAAGLLLLLFYANHLLSRPGACTSLNHTLSAVVWPAPVLG
IALLLHCRRPLAWWLGAGSLFATLLAAGSLDWVPWHVDALFAAVNVVEAIAGAWLARRYLIAGGGVDTLRGFAMFVLLLP
LGMAAMHATLAAAILSVWMNDREWLSEWSRAYAANALALLVLLPALLTWNARACGAAWSRSRNQLPVLATFGSLCFASIW
GYQAEVARALLALSLSWAALEGGLVLASQLNALSAIALIAMTLGGRGPYAWHHDGHGVWALQVDLIGVAILSMCIAIATG
ERRRLARQIERSRRFESLGFFAGGIVHDFSNVLTTIDCHAEYASERLASGARADDSIDEIHRAVERGRDLAAQILLAARR
GEPVLTRVSVDEVVDEALAATRAAAWRGVEIVRCGDGARDGARRGDVRHVVFADRSQLARAVMNLVGNAVRAARATVVVR
VGVNGGVNGGASDGASRGANDGGAPAARAFDVAIGEAAMPGGVWIEVSDDGEGIDVEPLDRIFEPFYSNRSGAPGTGLGL
AIVAGAALAHRGQIAVATDRGAGSCFRLTLPAAWGTGAPGAMDAGAPGAVQERT
>Mature_614_residues
MHGNSIDAGPPARARPARITRTARTAPRRDDRAFAPGGALNAAGLLLLLFYANHLLSRPGACTSLNHTLSAVVWPAPVLG
IALLLHCRRPLAWWLGAGSLFATLLAAGSLDWVPWHVDALFAAVNVVEAIAGAWLARRYLIAGGGVDTLRGFAMFVLLLP
LGMAAMHATLAAAILSVWMNDREWLSEWSRAYAANALALLVLLPALLTWNARACGAAWSRSRNQLPVLATFGSLCFASIW
GYQAEVARALLALSLSWAALEGGLVLASQLNALSAIALIAMTLGGRGPYAWHHDGHGVWALQVDLIGVAILSMCIAIATG
ERRRLARQIERSRRFESLGFFAGGIVHDFSNVLTTIDCHAEYASERLASGARADDSIDEIHRAVERGRDLAAQILLAARR
GEPVLTRVSVDEVVDEALAATRAAAWRGVEIVRCGDGARDGARRGDVRHVVFADRSQLARAVMNLVGNAVRAARATVVVR
VGVNGGVNGGASDGASRGANDGGAPAARAFDVAIGEAAMPGGVWIEVSDDGEGIDVEPLDRIFEPFYSNRSGAPGTGLGL
AIVAGAALAHRGQIAVATDRGAGSCFRLTLPAAWGTGAPGAMDAGAPGAVQERT

Specific function: Activates virG, by phosphorylating it, in the presence of acetosyringone or hydroxysyringone [H]

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cell membrane; Multi-pass membrane protein (Potential) [H]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 histidine kinase domain [H]

Homologues:

Organism=Escherichia coli, GI1790436, Length=271, Percent_Identity=26.1992619926199, Blast_Score=92, Evalue=9e-20,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR003594
- InterPro:   IPR004358
- InterPro:   IPR003661
- InterPro:   IPR005467
- InterPro:   IPR009082 [H]

Pfam domain/function: PF02518 HATPase_c; PF00512 HisKA [H]

EC number: =2.7.13.3 [H]

Molecular weight: Translated: 64336; Mature: 64336

Theoretical pI: Translated: 8.42; Mature: 8.42

Prosite motif: PS50109 HIS_KIN

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.3 %Cys     (Translated Protein)
1.6 %Met     (Translated Protein)
2.9 %Cys+Met (Translated Protein)
1.3 %Cys     (Mature Protein)
1.6 %Met     (Mature Protein)
2.9 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MHGNSIDAGPPARARPARITRTARTAPRRDDRAFAPGGALNAAGLLLLLFYANHLLSRPG
CCCCCCCCCCCCCCCCCHHHHHHHCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHCCCC
ACTSLNHTLSAVVWPAPVLGIALLLHCRRPLAWWLGAGSLFATLLAAGSLDWVPWHVDAL
CCCCHHHHHHHHHCCHHHHHHHHHHHHCCCHHHHHCCHHHHHHHHHCCCCCCCHHHHHHH
FAAVNVVEAIAGAWLARRYLIAGGGVDTLRGFAMFVLLLPLGMAAMHATLAAAILSVWMN
HHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCC
DREWLSEWSRAYAANALALLVLLPALLTWNARACGAAWSRSRNQLPVLATFGSLCFASIW
CHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHCCCCCCCHHHHHHHHHHHHHH
GYQAEVARALLALSLSWAALEGGLVLASQLNALSAIALIAMTLGGRGPYAWHHDGHGVWA
CHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHCCCCCCCEEECCCEEEE
LQVDLIGVAILSMCIAIATGERRRLARQIERSRRFESLGFFAGGIVHDFSNVLTTIDCHA
EHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
EYASERLASGARADDSIDEIHRAVERGRDLAAQILLAARRGEPVLTRVSVDEVVDEALAA
HHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEECCHHHHHHHHHHH
TRAAAWRGVEIVRCGDGARDGARRGDVRHVVFADRSQLARAVMNLVGNAVRAARATVVVR
HHHHHHCCEEEEECCCCCCCCCCCCCCEEEEECCHHHHHHHHHHHHHHHHHHHEEEEEEE
VGVNGGVNGGASDGASRGANDGGAPAARAFDVAIGEAAMPGGVWIEVSDDGEGIDVEPLD
ECCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHCCCCCCCCEEEEECCCCCCCCCCHHH
RIFEPFYSNRSGAPGTGLGLAIVAGAALAHRGQIAVATDRGAGSCFRLTLPAAWGTGAPG
HHHHHHHCCCCCCCCCCHHHHHHHHHHHHCCCCEEEEECCCCCCEEEEEECCCCCCCCCC
AMDAGAPGAVQERT
CCCCCCCCCCCCCC
>Mature Secondary Structure
MHGNSIDAGPPARARPARITRTARTAPRRDDRAFAPGGALNAAGLLLLLFYANHLLSRPG
CCCCCCCCCCCCCCCCCHHHHHHHCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHHCCCC
ACTSLNHTLSAVVWPAPVLGIALLLHCRRPLAWWLGAGSLFATLLAAGSLDWVPWHVDAL
CCCCHHHHHHHHHCCHHHHHHHHHHHHCCCHHHHHCCHHHHHHHHHCCCCCCCHHHHHHH
FAAVNVVEAIAGAWLARRYLIAGGGVDTLRGFAMFVLLLPLGMAAMHATLAAAILSVWMN
HHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCC
DREWLSEWSRAYAANALALLVLLPALLTWNARACGAAWSRSRNQLPVLATFGSLCFASIW
CHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHCCCCCCCHHHHHHHHHHHHHH
GYQAEVARALLALSLSWAALEGGLVLASQLNALSAIALIAMTLGGRGPYAWHHDGHGVWA
CHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHCCCCCCCEEECCCEEEE
LQVDLIGVAILSMCIAIATGERRRLARQIERSRRFESLGFFAGGIVHDFSNVLTTIDCHA
EHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
EYASERLASGARADDSIDEIHRAVERGRDLAAQILLAARRGEPVLTRVSVDEVVDEALAA
HHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEECCHHHHHHHHHHH
TRAAAWRGVEIVRCGDGARDGARRGDVRHVVFADRSQLARAVMNLVGNAVRAARATVVVR
HHHHHHCCEEEEECCCCCCCCCCCCCCEEEEECCHHHHHHHHHHHHHHHHHHHEEEEEEE
VGVNGGVNGGASDGASRGANDGGAPAARAFDVAIGEAAMPGGVWIEVSDDGEGIDVEPLD
ECCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHCCCCCCCCEEEEECCCCCCCCCCHHH
RIFEPFYSNRSGAPGTGLGLAIVAGAALAHRGQIAVATDRGAGSCFRLTLPAAWGTGAPG
HHHHHHHCCCCCCCCCCHHHHHHHHHHHHCCCCEEEEECCCCCCEEEEEECCCCCCCCCC
AMDAGAPGAVQERT
CCCCCCCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 2796735; 2194232; 11743193; 11743194 [H]