The gene/protein map for NC_002932 is currently unavailable.
Definition Chlorobium tepidum TLS, complete genome.
Accession NC_002932
Length 2,154,946

Click here to switch to the map view.

The map label for this gene is virA [H]

Identifier: 21674870

GI number: 21674870

Start: 1955978

End: 1958005

Strand: Direct

Name: virA [H]

Synonym: CT2060

Alternate gene names: 21674870

Gene position: 1955978-1958005 (Clockwise)

Preceding gene: 21674869

Following gene: 21674871

Centisome position: 90.77

GC content: 51.97

Gene sequence:

>2028_bases
ATGCTCAAGGGGAGCATCGAAGCGCTTGAGAAAAAAATCGCCATGCTTGAAAACAGAGCCTCAATTGCCGAACAGAAGGC
TGATGCGCTGAAAACAGCCCTTGAATCAGCCCGGGCAGGGTACTGGGAGTGGAATGTCGAAAACGGGACGATTCTTATCG
ACCGGCAATGGGCTGTCATTAGCGGTTACAACTCGGCCGATTTTGATATGCTGACGATGGAACAGTGGCGTGAGCTGTGC
CACCCGGCCGATCTTGGCGTGGTCACAAAATCGATAGAAGAGCTTCTGGATGGCAGCATGGAGCGTCTTGAACTTGAACT
GCGGGTCCGCCATAAGAATGGCGAATGGATCCGGGTGCTCGACTGCGGCAAGGTCACCGGACGCAGCAAGAACGGTAAAC
CGTCATGCCTGACCGGTTCAAGGCAGGCACTGGCAAGCCTGCACGACAAACCTGAATCACCGGTAAAAAATGTGCCGGAG
GAACTGCAAGCGCTGGTCGACAATATCCCGGCGGCGATTTATCACCTTGATGTCTCAGGGCAAGCCACCATTCGTTTCCG
GCCACCGGCCTTTCTGAAAACCCTTGTTTCAGAGCATGCCGGCACAACCCGGCTGAACACCCTTTCGATGATTCACCATG
ATGACCGGCATATGCTGAGCAACGCCTACAGCAAACTCAGAGAAGCCAAACATTCCCTTACTCTGGTCTACCGTATAGTC
ACCCCGGAGGGAAAACTGCACTGGATCGAAGACCATATGAGGTCATCGTTCTCGGATGATGGACTTTTTTCAGGAATCGA
CGGTATCCTGTGCGAAGTCACCGACCGGATCGCCAGACTCGAAAAAACACGCAAGCTCGAATCGCAACTGAGCAAATCGC
AGAGACTCGAAACCATCGGGACCCTTGCCGGCGGTATCGCGCATGACTTCAACAACATCCTCACGCCGATTCTCGGTTAC
GCCGAAATGGGGCTTTCGAGTATCGATGAAGATGACCCGATACATGAATATTTCGCTGAAATCATGCAGGCCGCAGAACG
GGCACAAAAGCTTGTCTCACAAATCCTGACCTTCAGCAAGGCAGAAGAGGGCAAGACCGCGCCTGTAAGCATTCAGGAGG
TCATTGACGAAGTGATCCGGCTTATGCGGCCATCGCTGCCATCGAGCGTTTCCATTGAAGAGGATATTGACAGTTCATGC
CACAAGGTTATCGCAGACCCGGCCCAGATGCACCAGGTTGTCGTCAATCTGTGCACCAATGCCCTCCATGCGATGGAACA
GACTGGCGGAGTCCTGAAGATCGTGCTCAGGGAAGTGAGCACCGGAAACGGGATGCCGCCGATAGCACCGGAACTGCCTG
ATGGAAACTATGCAGAACTGATCATTTCCGATACCGGAACCGGTATGGATAGCAGAGCCATAGAACGTATTTTCGAACCA
TTCTTCACGACAAAATCGGTCGAAAAAGGGTCTGGACTCGGCCTGTCGGTCGTTCACGGCATCGTGACCGGCGCCAACGG
ACATATCAGCGTTGAAAGCACGCAAGGGAAGGGTTCTGCGTTCCATGTCTGGCTGCCGGTTATCAAAAGTAACACCCCCG
ACAGATTGGAACAAAACCCACTGTTAGCAAAATATGCTGCCAGTGTTCTCTTTATCGACGATGAACCGGCTACAGTGAAT
CTGGTAACAATCATGATGACCAAGCTCGGCTATAATATCAGGGCAGAAAACTCTCCGGTCGAGGCGCTGAAATTCTTCAG
AGAACAACCAGACCAGTTTGACCTGGTAATCACTGACCTGACCATGCCTGAAATGACCGGCATACAGTTGAGCAGCGAGA
TCCACAAAATCGCGCCCTCGATTCCGGTGATTCTGATGACTGGATACGGAAAAATGATTGACCACGATATGCCGCTGAGA
CACTACGGCATAAACCACTTGTTAAAAAAACCGCTCAAGCTTGCTCACTTGGCGTTGGCTGTCAAAGAAGTACTCTCATC
AACAACCAATCTCCTCACAGAAATATGA

Upstream 100 bases:

>100_bases
GCCATATCAAAACCCTATCCGCCAGCGAACTGCACCCAGTCACAAACTTTCAGTAATGAACAGTCACAAAACGGATGTGC
CGGCAGGCGATGAAAACAGC

Downstream 100 bases:

>100_bases
AAATTCTTGTCATCGATGACGATCCTTCCGTCAGAAAATTCATAACCACAACGCTGAAAAAGGAAAACTATGCCGTTACC
GAAGCGGAAAACGGCGCAGA

Product: sensory box histidine kinase/response regulator

Products: NA

Alternate protein names: WHR virA [H]

Number of amino acids: Translated: 675; Mature: 675

Protein sequence:

>675_residues
MLKGSIEALEKKIAMLENRASIAEQKADALKTALESARAGYWEWNVENGTILIDRQWAVISGYNSADFDMLTMEQWRELC
HPADLGVVTKSIEELLDGSMERLELELRVRHKNGEWIRVLDCGKVTGRSKNGKPSCLTGSRQALASLHDKPESPVKNVPE
ELQALVDNIPAAIYHLDVSGQATIRFRPPAFLKTLVSEHAGTTRLNTLSMIHHDDRHMLSNAYSKLREAKHSLTLVYRIV
TPEGKLHWIEDHMRSSFSDDGLFSGIDGILCEVTDRIARLEKTRKLESQLSKSQRLETIGTLAGGIAHDFNNILTPILGY
AEMGLSSIDEDDPIHEYFAEIMQAAERAQKLVSQILTFSKAEEGKTAPVSIQEVIDEVIRLMRPSLPSSVSIEEDIDSSC
HKVIADPAQMHQVVVNLCTNALHAMEQTGGVLKIVLREVSTGNGMPPIAPELPDGNYAELIISDTGTGMDSRAIERIFEP
FFTTKSVEKGSGLGLSVVHGIVTGANGHISVESTQGKGSAFHVWLPVIKSNTPDRLEQNPLLAKYAASVLFIDDEPATVN
LVTIMMTKLGYNIRAENSPVEALKFFREQPDQFDLVITDLTMPEMTGIQLSSEIHKIAPSIPVILMTGYGKMIDHDMPLR
HYGINHLLKKPLKLAHLALAVKEVLSSTTNLLTEI

Sequences:

>Translated_675_residues
MLKGSIEALEKKIAMLENRASIAEQKADALKTALESARAGYWEWNVENGTILIDRQWAVISGYNSADFDMLTMEQWRELC
HPADLGVVTKSIEELLDGSMERLELELRVRHKNGEWIRVLDCGKVTGRSKNGKPSCLTGSRQALASLHDKPESPVKNVPE
ELQALVDNIPAAIYHLDVSGQATIRFRPPAFLKTLVSEHAGTTRLNTLSMIHHDDRHMLSNAYSKLREAKHSLTLVYRIV
TPEGKLHWIEDHMRSSFSDDGLFSGIDGILCEVTDRIARLEKTRKLESQLSKSQRLETIGTLAGGIAHDFNNILTPILGY
AEMGLSSIDEDDPIHEYFAEIMQAAERAQKLVSQILTFSKAEEGKTAPVSIQEVIDEVIRLMRPSLPSSVSIEEDIDSSC
HKVIADPAQMHQVVVNLCTNALHAMEQTGGVLKIVLREVSTGNGMPPIAPELPDGNYAELIISDTGTGMDSRAIERIFEP
FFTTKSVEKGSGLGLSVVHGIVTGANGHISVESTQGKGSAFHVWLPVIKSNTPDRLEQNPLLAKYAASVLFIDDEPATVN
LVTIMMTKLGYNIRAENSPVEALKFFREQPDQFDLVITDLTMPEMTGIQLSSEIHKIAPSIPVILMTGYGKMIDHDMPLR
HYGINHLLKKPLKLAHLALAVKEVLSSTTNLLTEI
>Mature_675_residues
MLKGSIEALEKKIAMLENRASIAEQKADALKTALESARAGYWEWNVENGTILIDRQWAVISGYNSADFDMLTMEQWRELC
HPADLGVVTKSIEELLDGSMERLELELRVRHKNGEWIRVLDCGKVTGRSKNGKPSCLTGSRQALASLHDKPESPVKNVPE
ELQALVDNIPAAIYHLDVSGQATIRFRPPAFLKTLVSEHAGTTRLNTLSMIHHDDRHMLSNAYSKLREAKHSLTLVYRIV
TPEGKLHWIEDHMRSSFSDDGLFSGIDGILCEVTDRIARLEKTRKLESQLSKSQRLETIGTLAGGIAHDFNNILTPILGY
AEMGLSSIDEDDPIHEYFAEIMQAAERAQKLVSQILTFSKAEEGKTAPVSIQEVIDEVIRLMRPSLPSSVSIEEDIDSSC
HKVIADPAQMHQVVVNLCTNALHAMEQTGGVLKIVLREVSTGNGMPPIAPELPDGNYAELIISDTGTGMDSRAIERIFEP
FFTTKSVEKGSGLGLSVVHGIVTGANGHISVESTQGKGSAFHVWLPVIKSNTPDRLEQNPLLAKYAASVLFIDDEPATVN
LVTIMMTKLGYNIRAENSPVEALKFFREQPDQFDLVITDLTMPEMTGIQLSSEIHKIAPSIPVILMTGYGKMIDHDMPLR
HYGINHLLKKPLKLAHLALAVKEVLSSTTNLLTEI

Specific function: Activates virG, by phosphorylating it, in the presence of acetosyringone or hydroxysyringone [H]

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cell membrane; Multi-pass membrane protein (Potential) [H]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 histidine kinase domain [H]

Homologues:

Organism=Escherichia coli, GI1788549, Length=262, Percent_Identity=29.7709923664122, Blast_Score=118, Evalue=1e-27,
Organism=Escherichia coli, GI1790436, Length=251, Percent_Identity=29.4820717131474, Blast_Score=115, Evalue=1e-26,
Organism=Escherichia coli, GI1788713, Length=525, Percent_Identity=24.952380952381, Blast_Score=103, Evalue=3e-23,
Organism=Escherichia coli, GI48994928, Length=463, Percent_Identity=22.0302375809935, Blast_Score=100, Evalue=2e-22,
Organism=Escherichia coli, GI87081816, Length=344, Percent_Identity=23.8372093023256, Blast_Score=89, Evalue=6e-19,
Organism=Escherichia coli, GI1790300, Length=289, Percent_Identity=29.0657439446367, Blast_Score=89, Evalue=7e-19,
Organism=Escherichia coli, GI145693157, Length=280, Percent_Identity=24.6428571428571, Blast_Score=83, Evalue=6e-17,
Organism=Escherichia coli, GI1789149, Length=275, Percent_Identity=26.1818181818182, Blast_Score=77, Evalue=3e-15,
Organism=Escherichia coli, GI1788905, Length=122, Percent_Identity=33.6065573770492, Blast_Score=70, Evalue=5e-13,
Organism=Escherichia coli, GI1790437, Length=126, Percent_Identity=32.5396825396825, Blast_Score=70, Evalue=6e-13,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR003594
- InterPro:   IPR004358
- InterPro:   IPR003661
- InterPro:   IPR005467
- InterPro:   IPR009082 [H]

Pfam domain/function: PF02518 HATPase_c; PF00512 HisKA [H]

EC number: =2.7.13.3 [H]

Molecular weight: Translated: 74603; Mature: 74603

Theoretical pI: Translated: 5.75; Mature: 5.75

Prosite motif: PS50110 RESPONSE_REGULATORY ; PS00063 ALDOKETO_REDUCTASE_3 ; PS50109 HIS_KIN

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.9 %Cys     (Translated Protein)
3.3 %Met     (Translated Protein)
4.1 %Cys+Met (Translated Protein)
0.9 %Cys     (Mature Protein)
3.3 %Met     (Mature Protein)
4.1 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MLKGSIEALEKKIAMLENRASIAEQKADALKTALESARAGYWEWNVENGTILIDRQWAVI
CCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEEECCCEEEEECCEEEE
SGYNSADFDMLTMEQWRELCHPADLGVVTKSIEELLDGSMERLELELRVRHKNGEWIRVL
ECCCCCCCHHHHHHHHHHHCCCCHHHHHHHHHHHHHCCCHHHEEEEEEEEECCCCEEEEE
DCGKVTGRSKNGKPSCLTGSRQALASLHDKPESPVKNVPEELQALVDNIPAAIYHLDVSG
ECCCCCCCCCCCCCCCCCCCHHHHHHHHCCCCCCHHHCCHHHHHHHHCCCEEEEEEECCC
QATIRFRPPAFLKTLVSEHAGTTRLNTLSMIHHDDRHMLSNAYSKLREAKHSLTLVYRIV
CEEEEECCHHHHHHHHHHCCCCCCHHHHHHHHCCHHHHHHHHHHHHHHHHHCEEEEEEEE
TPEGKLHWIEDHMRSSFSDDGLFSGIDGILCEVTDRIARLEKTRKLESQLSKSQRLETIG
CCCCCEEHHHHHHHCCCCCCCCHHCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
TLAGGIAHDFNNILTPILGYAEMGLSSIDEDDPIHEYFAEIMQAAERAQKLVSQILTFSK
HHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHH
AEEGKTAPVSIQEVIDEVIRLMRPSLPSSVSIEEDIDSSCHKVIADPAQMHQVVVNLCTN
CCCCCCCCCCHHHHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHHCCHHHHHHHHHHHHHH
ALHAMEQTGGVLKIVLREVSTGNGMPPIAPELPDGNYAELIISDTGTGMDSRAIERIFEP
HHHHHHHCCCHHHHHHHHHHCCCCCCCCCCCCCCCCEEEEEEECCCCCCHHHHHHHHHHH
FFTTKSVEKGSGLGLSVVHGIVTGANGHISVESTQGKGSAFHVWLPVIKSNTPDRLEQNP
HHCCCCCCCCCCCCHHHHHHHHCCCCCEEEEEECCCCCCEEEEEEEEECCCCCCHHHCCC
LLAKYAASVLFIDDEPATVNLVTIMMTKLGYNIRAENSPVEALKFFREQPDQFDLVITDL
HHHHHCCEEEEECCCCCEEHHHHHHHHHHCCCEECCCCHHHHHHHHHHCCCCEEEEEEEC
TMPEMTGIQLSSEIHKIAPSIPVILMTGYGKMIDHDMPLRHYGINHLLKKPLKLAHLALA
CCCCCCCCHHHHHHHHHCCCCCEEEEECCCHHHCCCCCHHHHCHHHHHHHHHHHHHHHHH
VKEVLSSTTNLLTEI
HHHHHHHHHHHHHCC
>Mature Secondary Structure
MLKGSIEALEKKIAMLENRASIAEQKADALKTALESARAGYWEWNVENGTILIDRQWAVI
CCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEEECCCEEEEECCEEEE
SGYNSADFDMLTMEQWRELCHPADLGVVTKSIEELLDGSMERLELELRVRHKNGEWIRVL
ECCCCCCCHHHHHHHHHHHCCCCHHHHHHHHHHHHHCCCHHHEEEEEEEEECCCCEEEEE
DCGKVTGRSKNGKPSCLTGSRQALASLHDKPESPVKNVPEELQALVDNIPAAIYHLDVSG
ECCCCCCCCCCCCCCCCCCCHHHHHHHHCCCCCCHHHCCHHHHHHHHCCCEEEEEEECCC
QATIRFRPPAFLKTLVSEHAGTTRLNTLSMIHHDDRHMLSNAYSKLREAKHSLTLVYRIV
CEEEEECCHHHHHHHHHHCCCCCCHHHHHHHHCCHHHHHHHHHHHHHHHHHCEEEEEEEE
TPEGKLHWIEDHMRSSFSDDGLFSGIDGILCEVTDRIARLEKTRKLESQLSKSQRLETIG
CCCCCEEHHHHHHHCCCCCCCCHHCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
TLAGGIAHDFNNILTPILGYAEMGLSSIDEDDPIHEYFAEIMQAAERAQKLVSQILTFSK
HHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHH
AEEGKTAPVSIQEVIDEVIRLMRPSLPSSVSIEEDIDSSCHKVIADPAQMHQVVVNLCTN
CCCCCCCCCCHHHHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHHCCHHHHHHHHHHHHHH
ALHAMEQTGGVLKIVLREVSTGNGMPPIAPELPDGNYAELIISDTGTGMDSRAIERIFEP
HHHHHHHCCCHHHHHHHHHHCCCCCCCCCCCCCCCCEEEEEEECCCCCCHHHHHHHHHHH
FFTTKSVEKGSGLGLSVVHGIVTGANGHISVESTQGKGSAFHVWLPVIKSNTPDRLEQNP
HHCCCCCCCCCCCCHHHHHHHHCCCCCEEEEEECCCCCCEEEEEEEEECCCCCCHHHCCC
LLAKYAASVLFIDDEPATVNLVTIMMTKLGYNIRAENSPVEALKFFREQPDQFDLVITDL
HHHHHCCEEEEECCCCCEEHHHHHHHHHHCCCEECCCCHHHHHHHHHHCCCCEEEEEEEC
TMPEMTGIQLSSEIHKIAPSIPVILMTGYGKMIDHDMPLRHYGINHLLKKPLKLAHLALA
CCCCCCCCHHHHHHHHHCCCCCEEEEECCCHHHCCCCCHHHHCHHHHHHHHHHHHHHHHH
VKEVLSSTTNLLTEI
HHHHHHHHHHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 3595559 [H]