Definition Xanthobacter autotrophicus Py2 chromosome, complete genome.
Accession NC_009720
Length 5,308,934

Click here to switch to the map view.

The map label for this gene is 154245966

Identifier: 154245966

GI number: 154245966

Start: 2280709

End: 2282499

Strand: Reverse

Name: 154245966

Synonym: Xaut_2023

Alternate gene names: NA

Gene position: 2282499-2280709 (Counterclockwise)

Preceding gene: 154245969

Following gene: 154245965

Centisome position: 42.99

GC content: 69.29

Gene sequence:

>1791_bases
ATGGATTTGGGCAAGGCGGAGGCCGCACGGGCACGAAACAGGGAGCGCAGCTCCATCTTTGCCTCGGCAGTCGGGCAGCC
GCGCACGCTTTTCGACAGCGTGCGGCGCCGCCTCGTCCTCGTGGTCCTGCTCGCGCTGGCCCCCATCGCGGTGCTGAACA
TCGTCCAGGGCGTGATGCAGCTCTCCGATGCGGAGGAAGCTGCGCGCCAGCGCCTGCTGCAGCAGGCCGTGGCCGCCGCC
GTCAGCCAGCAGAACATCTTCGCCTCCACAGAAAACGTGCTCTATGCGCTCAAGAACGTGGAAGAGGTGCGCGCGGCCGG
CCAAAGCTGCGCGGCCACCCTGCGTGGCGCCACCATCAGCCTGCCCTTCGCCGCCAATATCGGCGTGCTCGATGCCCAGG
GCAGGGTGACCTGCGCCGCCCTGCCCTTCCCCGGCCGCTCGGTGGGCGAGGAGCCCTGGTGGAAGGAGGCCATTGGCAGG
ACCGGCTTCAGCCTGGTAGGGCCGACGCGCAGCCCCGGTGCCAATCTGGACGTGCTGGTGGGCATCCTGCCGCTGCGCGA
CGCCGCCGGGCGGCTGGAAGGCGCCATCGCCCTGGGCATCGATATCAGATGGCTCGACAACCTGCTGAAGCAGCAGATCC
CGCCCTCAGCGGGCATCGTCGCCCTGTTCTCTAACCGGGGGCAGGAGCTGGTGTCCAATGCCCGGACCATGAGCGCCGCC
CTGTTCCAGCGCGAGATGTTCCAGACCACCGGCCAGGACGTACGTAGCAATCTCTACGAAAACACCGATCCCGCCGGCAA
GAGCTGGACCTTCGCCACCGCGCCGCTGGACCGCGACGGCCTCACCGTGGCCTTCGCCATGCCCTCGGACCGGCTGTTCG
GCTGGACCTTCGTGACGGTGGCGGCGAGCATCGCCCTGCCGGCGCTCATCATCATCCTGTCACTCGCCGCCCTGTGGGTG
GCGGTGGACCGCATCATCCTGCGCTGGCTGCTTTATCTGCGCCGGGTGACGGCGGTCTATGCCCAGGGCCACTACGGCTT
CCGCCCTACCCGCCTCGGAGCGGCGCCCTCGGAATTCCGCGTGCTCGGCCATGCGGTGGAGAACATGGCCTTCGCCGTGC
GCCACCGCGACGCCCGCCTGCGCGAGAACCTGGCCGAGAAGACCGCGCTGGTGCGCGAGATCCACCACCGCATCAAGAAC
AGCCTGCAGGTGGTGGTGAGCCTGCTCAGCCTCTACGGATCGGGTATCGGCAAGAGCGAGGACCGCCGCCGCTTCGACCA
GCTGCGGCTGCGGGTGAACACCCTCGCCCTGGTCCACCGCATCCTCTACGAGGCCAATGACGGTTCCCAGGTGCACCTGC
GCGAGCTGCTCGGCGAGCTGGCCTCGCTGATCGAGGGCAGCACCGACGCCAACGTCCGCATCACCGTGGAGGCGCAGGAT
GCGCCCCTGCCCACCGACATGGCAGTACCCCTTGCCCTCATGGTGGTGGAAGTGGCGCTCAATCTCGCCCTGCCGCAGGG
CACCGGGTCCGCTGCCGTGCTGTTGAGCGGAAGCCGGAATGGCGAGCGCCTCCATATCGCCCTGCGCAGCGCCACGGGGA
CCTGGGACTCGAAAGGCTCGGCCACCGACCTCGCCTCCGGATTTGCCGCCCAGCTCGGAGGCAGCCTCGGCTGCCGCGAC
GAGGCCGGCGGCGGCCTGGTGGTGGCCGGCGACTTCCCCTGCCGCCCCAACACAGGACCCAGGACGACAGTACCCCGGAC
CACAGGCCCCAATACCGGCCGCATGGCCTGA

Upstream 100 bases:

>100_bases
ATAAGCCGCGCGTTTCCGGCTGCCGCCGGAGGCCGCAGAAAAGAGGCGCGGGCACGGGTTTCCGGGGGGTCCGGCGCGCC
GCTGTCCTTGCGGAGCGATC

Downstream 100 bases:

>100_bases
AGCCTTCCGCACGCCGGTGCCGGGCACCGGGGCGGAAACGGCGGTTTTTCCTCACGACTGCAGGATCGGGCCGAGCGCCG
GCTCAAACTTGGGCGGTTCA

Product: signal transduction histidine kinase

Products: NA

Alternate protein names: Sensory Transduction Histidine Kinase; Sensor Histidine Kinase; Sensory Transduction Protein Kinase; Two-Component Sensor Histidine Kinase; Sensory Transduction Regulatory Protein; Two Component Hybrid Sensor Histidine Kinase And Regulator; Histidine Kinase Family

Number of amino acids: Translated: 596; Mature: 596

Protein sequence:

>596_residues
MDLGKAEAARARNRERSSIFASAVGQPRTLFDSVRRRLVLVVLLALAPIAVLNIVQGVMQLSDAEEAARQRLLQQAVAAA
VSQQNIFASTENVLYALKNVEEVRAAGQSCAATLRGATISLPFAANIGVLDAQGRVTCAALPFPGRSVGEEPWWKEAIGR
TGFSLVGPTRSPGANLDVLVGILPLRDAAGRLEGAIALGIDIRWLDNLLKQQIPPSAGIVALFSNRGQELVSNARTMSAA
LFQREMFQTTGQDVRSNLYENTDPAGKSWTFATAPLDRDGLTVAFAMPSDRLFGWTFVTVAASIALPALIIILSLAALWV
AVDRIILRWLLYLRRVTAVYAQGHYGFRPTRLGAAPSEFRVLGHAVENMAFAVRHRDARLRENLAEKTALVREIHHRIKN
SLQVVVSLLSLYGSGIGKSEDRRRFDQLRLRVNTLALVHRILYEANDGSQVHLRELLGELASLIEGSTDANVRITVEAQD
APLPTDMAVPLALMVVEVALNLALPQGTGSAAVLLSGSRNGERLHIALRSATGTWDSKGSATDLASGFAAQLGGSLGCRD
EAGGGLVVAGDFPCRPNTGPRTTVPRTTGPNTGRMA

Sequences:

>Translated_596_residues
MDLGKAEAARARNRERSSIFASAVGQPRTLFDSVRRRLVLVVLLALAPIAVLNIVQGVMQLSDAEEAARQRLLQQAVAAA
VSQQNIFASTENVLYALKNVEEVRAAGQSCAATLRGATISLPFAANIGVLDAQGRVTCAALPFPGRSVGEEPWWKEAIGR
TGFSLVGPTRSPGANLDVLVGILPLRDAAGRLEGAIALGIDIRWLDNLLKQQIPPSAGIVALFSNRGQELVSNARTMSAA
LFQREMFQTTGQDVRSNLYENTDPAGKSWTFATAPLDRDGLTVAFAMPSDRLFGWTFVTVAASIALPALIIILSLAALWV
AVDRIILRWLLYLRRVTAVYAQGHYGFRPTRLGAAPSEFRVLGHAVENMAFAVRHRDARLRENLAEKTALVREIHHRIKN
SLQVVVSLLSLYGSGIGKSEDRRRFDQLRLRVNTLALVHRILYEANDGSQVHLRELLGELASLIEGSTDANVRITVEAQD
APLPTDMAVPLALMVVEVALNLALPQGTGSAAVLLSGSRNGERLHIALRSATGTWDSKGSATDLASGFAAQLGGSLGCRD
EAGGGLVVAGDFPCRPNTGPRTTVPRTTGPNTGRMA
>Mature_596_residues
MDLGKAEAARARNRERSSIFASAVGQPRTLFDSVRRRLVLVVLLALAPIAVLNIVQGVMQLSDAEEAARQRLLQQAVAAA
VSQQNIFASTENVLYALKNVEEVRAAGQSCAATLRGATISLPFAANIGVLDAQGRVTCAALPFPGRSVGEEPWWKEAIGR
TGFSLVGPTRSPGANLDVLVGILPLRDAAGRLEGAIALGIDIRWLDNLLKQQIPPSAGIVALFSNRGQELVSNARTMSAA
LFQREMFQTTGQDVRSNLYENTDPAGKSWTFATAPLDRDGLTVAFAMPSDRLFGWTFVTVAASIALPALIIILSLAALWV
AVDRIILRWLLYLRRVTAVYAQGHYGFRPTRLGAAPSEFRVLGHAVENMAFAVRHRDARLRENLAEKTALVREIHHRIKN
SLQVVVSLLSLYGSGIGKSEDRRRFDQLRLRVNTLALVHRILYEANDGSQVHLRELLGELASLIEGSTDANVRITVEAQD
APLPTDMAVPLALMVVEVALNLALPQGTGSAAVLLSGSRNGERLHIALRSATGTWDSKGSATDLASGFAAQLGGSLGCRD
EAGGGLVVAGDFPCRPNTGPRTTVPRTTGPNTGRMA

Specific function: Unknown

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 63926; Mature: 63926

Theoretical pI: Translated: 10.09; Mature: 10.09

Prosite motif: PS50885 HAMP

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.7 %Cys     (Translated Protein)
1.5 %Met     (Translated Protein)
2.2 %Cys+Met (Translated Protein)
0.7 %Cys     (Mature Protein)
1.5 %Met     (Mature Protein)
2.2 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MDLGKAEAARARNRERSSIFASAVGQPRTLFDSVRRRLVLVVLLALAPIAVLNIVQGVMQ
CCCCHHHHHHHHCHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
LSDAEEAARQRLLQQAVAAAVSQQNIFASTENVLYALKNVEEVRAAGQSCAATLRGATIS
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHCCCEEE
LPFAANIGVLDAQGRVTCAALPFPGRSVGEEPWWKEAIGRTGFSLVGPTRSPGANLDVLV
ECCCCCCCEEECCCCEEEEECCCCCCCCCCCCHHHHHHCCCCCEEECCCCCCCCCCEEEE
GILPLRDAAGRLEGAIALGIDIRWLDNLLKQQIPPSAGIVALFSNRGQELVSNARTMSAA
EEHHHHHHHHHHCCEEEEECCHHHHHHHHHHHCCCCCCEEEEECCCCHHHHHHHHHHHHH
LFQREMFQTTGQDVRSNLYENTDPAGKSWTFATAPLDRDGLTVAFAMPSDRLFGWTFVTV
HHHHHHHHHCCHHHHHHHHCCCCCCCCCEEEEECCCCCCCCEEEEECCCCCCHHHHHHHH
AASIALPALIIILSLAALWVAVDRIILRWLLYLRRVTAVYAQGHYGFRPTRLGAAPSEFR
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCHHHHH
VLGHAVENMAFAVRHRDARLRENLAEKTALVREIHHRIKNSLQVVVSLLSLYGSGIGKSE
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCH
DRRRFDQLRLRVNTLALVHRILYEANDGSQVHLRELLGELASLIEGSTDANVRITVEAQD
HHHHHHHHHHHHHHHHHHHHHHHCCCCCCEEHHHHHHHHHHHHHCCCCCCCEEEEEEECC
APLPTDMAVPLALMVVEVALNLALPQGTGSAAVLLSGSRNGERLHIALRSATGTWDSKGS
CCCCCCHHHHHHHHHHHHHHHHCCCCCCCCEEEEEECCCCCCEEEEEEEECCCCCCCCCC
ATDLASGFAAQLGGSLGCRDEAGGGLVVAGDFPCRPNTGPRTTVPRTTGPNTGRMA
HHHHHHHHHHHHCCCCCCCCCCCCCEEEECCCCCCCCCCCCCCCCCCCCCCCCCCC
>Mature Secondary Structure
MDLGKAEAARARNRERSSIFASAVGQPRTLFDSVRRRLVLVVLLALAPIAVLNIVQGVMQ
CCCCHHHHHHHHCHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
LSDAEEAARQRLLQQAVAAAVSQQNIFASTENVLYALKNVEEVRAAGQSCAATLRGATIS
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHCCCEEE
LPFAANIGVLDAQGRVTCAALPFPGRSVGEEPWWKEAIGRTGFSLVGPTRSPGANLDVLV
ECCCCCCCEEECCCCEEEEECCCCCCCCCCCCHHHHHHCCCCCEEECCCCCCCCCCEEEE
GILPLRDAAGRLEGAIALGIDIRWLDNLLKQQIPPSAGIVALFSNRGQELVSNARTMSAA
EEHHHHHHHHHHCCEEEEECCHHHHHHHHHHHCCCCCCEEEEECCCCHHHHHHHHHHHHH
LFQREMFQTTGQDVRSNLYENTDPAGKSWTFATAPLDRDGLTVAFAMPSDRLFGWTFVTV
HHHHHHHHHCCHHHHHHHHCCCCCCCCCEEEEECCCCCCCCEEEEECCCCCCHHHHHHHH
AASIALPALIIILSLAALWVAVDRIILRWLLYLRRVTAVYAQGHYGFRPTRLGAAPSEFR
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCHHHHH
VLGHAVENMAFAVRHRDARLRENLAEKTALVREIHHRIKNSLQVVVSLLSLYGSGIGKSE
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCH
DRRRFDQLRLRVNTLALVHRILYEANDGSQVHLRELLGELASLIEGSTDANVRITVEAQD
HHHHHHHHHHHHHHHHHHHHHHHCCCCCCEEHHHHHHHHHHHHHCCCCCCCEEEEEEECC
APLPTDMAVPLALMVVEVALNLALPQGTGSAAVLLSGSRNGERLHIALRSATGTWDSKGS
CCCCCCHHHHHHHHHHHHHHHHCCCCCCCCEEEEEECCCCCCEEEEEEEECCCCCCCCCC
ATDLASGFAAQLGGSLGCRDEAGGGLVVAGDFPCRPNTGPRTTVPRTTGPNTGRMA
HHHHHHHHHHHHCCCCCCCCCCCCCEEEECCCCCCCCCCCCCCCCCCCCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA