Definition Shewanella sp. W3-18-1 chromosome, complete genome.
Accession NC_008750
Length 4,708,380

Click here to switch to the map view.

The map label for this gene is phoB [C]

Identifier: 120597502

GI number: 120597502

Start: 737791

End: 739425

Strand: Direct

Name: phoB [C]

Synonym: Sputw3181_0671

Alternate gene names: 120597502

Gene position: 737791-739425 (Clockwise)

Preceding gene: 120597501

Following gene: 120597504

Centisome position: 15.67

GC content: 43.91

Gene sequence:

>1635_bases
ATGGGAATGGCTACTATCCCATCGCTACATGTGTCTATTGGAGAAGCACTGTTGTCATCATTTTCTTGGGTTCTTTCTCT
CACTATCATCTTGGTTTTATCTTTCTATTTGGCCAAGTTAACGCGCACATACAAAGCAAAGGTGAAGTCATTTCAGGTTG
AACTTACTCAGGCTAATAAAACAATACAATCACTTACACAACAACGTGAATGTGAACAGCGCACCTTTGGTCAGCTATTT
ACTGAAATAACAAAAAATGTCACTTGGTTAGCCCCCTATATTGCCAACACTCAGACCCATACTGATGAGATGAACGCATT
ATTACTGCGCATCAATCAGTTACTCGAGAGTACAAGGCAATGGAATGAGTCATCTCGCCAGATGTTATCCTCACCATTTT
TGTTGCAACCTTGGCTAAAAAATCAGTTAAGTTTCGAAAAGGCGAAGAGCCAACAACCATTACCCATTCATATCAGTGAG
ATCCCCGATCTGCTTGTTCAAACCCATCTTGAACTGTTAGAAAAAGTCTTCAGCAAGTTTTGTCAGGACATCAGACAATC
GACGGGCATAGCAGGCTATGTACTTGAGATAGAGTCAAAGCAAGGGCTTCGCTTGACTTTAACGGGCAAAGTCGAGGCTA
CGCGGGAAGAATATGCCGATGACAGCTACCTGCTGCTAAAAAAACAGGTGGAAGAAAATGGGGGGGAACTCTGTTGCCTG
CATAGCTCACAATCAATAGCGCAATATACGCTATGCCTACCAGCGACTGTTTATGAATTACCGCAATTTACGCCGGATTT
CAGATATCTACAGCACCATGTTGCCGATGAGAGCAAAGCTAAAGTGTTGATCGTCGAGAGCGACCCTGAGTTTATGGATT
GGCTTTATTACCACTTAGCGGCGGATTTTCGGCTCACTCTTTGCCAAACATGGCAAGGAGCGCAATATGAGTTAGATGAA
CAGGGCGCAGAATTAATCCTATGTGATACCCAGTTAAGTGATGGCGATGCGGCCAGTTGGTTGTCAACACTCAAACATCA
ACCTGAATATACCGCTATTCCGTTTGTGATGTTAACTGCGGTTGATGATCCGCAGCAACGCTTACAGGCATGGCAGTGTT
ATGCCGATGATTACGTCAGCAAAAACAGCGATCCCGGATTATTGGTTGTGAGGTTAAATGCTTTAATTGAAAATAGGCGC
CTTGTGCAGCAGCAAATGTTATCGCTTTCCTTAGCGATAAATTCTGTGCAAGCATCCACTTCAACGCCTGTGCTAAGTAC
AGTAGAAACCCTCGATGAACAATTCGCTAAACGATTAAGGTTAGTGATCGATCAACACATTACTACACAGGAATTGACGG
TTGAGTTTGTCGCACAGCAGTTTCATACCAGTAGCCGCTCATTGCAGCGGCGGGTACAAAGCGTATTTGGTTTGTCATAT
TCCCAATATTTAAAGCAAACCCAATTACAAATCGCTAAGGATGCTTTAGTTGCGGGGCATACCGTTAAAGAAGCCGCCTA
CTATGCAGGCTTTACCAGTCAAAATTACTTTGGCCGCGTCTTTAGAGCGGAATATGGGGTAACGCCCAGCCAATTTAAAA
AGGATGCAAGCACTAAACCGCCAAGCTTGGCCTAA

Upstream 100 bases:

>100_bases
ATGTTGAAGTGCTTAAGTGGTGTAGTTGAGCGATTCGTTGATATCAAAATGTGATATTGAACTACTAAAGTTGATTGCCA
TAAATAAAGAAATCCTCACC

Downstream 100 bases:

>100_bases
TTTTTTTTAATTGCATAGCCTCACCTAAGAGGCGATCAATGACTTGTCGATCGCTTTCTTCAGAGTGGTGTTGAACACAA
AAAGTGCTGATAGCAAGTGA

Product: response regulator receiver protein

Products: NA

Alternate protein names: Two-Component System Sensor Histidine Kinase/Response; Integral Membrane Sensor Hybrid Histidine Kinase; Two Component Transcriptional Regulator AraC Family; Two-Component System Sensor Kinase/Response Regulator; Response Regulator Receiver; Sensor Histidine Kinase/Response Regulator; Two-Component System Sensor Histidine Kinase; Sensor Histidine Kinase; Response Regulator Receiver Domain Protein; Two Component Transcriptional Regulator Arac Family; Two-Component Sensor Histidine Kinase; Response Regulator Receiver Sensor Hybrid Histidine Kinase; Two Component AraC Family Transcriptional Regulator; Response Regulator Receiver Protein

Number of amino acids: Translated: 544; Mature: 543

Protein sequence:

>544_residues
MGMATIPSLHVSIGEALLSSFSWVLSLTIILVLSFYLAKLTRTYKAKVKSFQVELTQANKTIQSLTQQRECEQRTFGQLF
TEITKNVTWLAPYIANTQTHTDEMNALLLRINQLLESTRQWNESSRQMLSSPFLLQPWLKNQLSFEKAKSQQPLPIHISE
IPDLLVQTHLELLEKVFSKFCQDIRQSTGIAGYVLEIESKQGLRLTLTGKVEATREEYADDSYLLLKKQVEENGGELCCL
HSSQSIAQYTLCLPATVYELPQFTPDFRYLQHHVADESKAKVLIVESDPEFMDWLYYHLAADFRLTLCQTWQGAQYELDE
QGAELILCDTQLSDGDAASWLSTLKHQPEYTAIPFVMLTAVDDPQQRLQAWQCYADDYVSKNSDPGLLVVRLNALIENRR
LVQQQMLSLSLAINSVQASTSTPVLSTVETLDEQFAKRLRLVIDQHITTQELTVEFVAQQFHTSSRSLQRRVQSVFGLSY
SQYLKQTQLQIAKDALVAGHTVKEAAYYAGFTSQNYFGRVFRAEYGVTPSQFKKDASTKPPSLA

Sequences:

>Translated_544_residues
MGMATIPSLHVSIGEALLSSFSWVLSLTIILVLSFYLAKLTRTYKAKVKSFQVELTQANKTIQSLTQQRECEQRTFGQLF
TEITKNVTWLAPYIANTQTHTDEMNALLLRINQLLESTRQWNESSRQMLSSPFLLQPWLKNQLSFEKAKSQQPLPIHISE
IPDLLVQTHLELLEKVFSKFCQDIRQSTGIAGYVLEIESKQGLRLTLTGKVEATREEYADDSYLLLKKQVEENGGELCCL
HSSQSIAQYTLCLPATVYELPQFTPDFRYLQHHVADESKAKVLIVESDPEFMDWLYYHLAADFRLTLCQTWQGAQYELDE
QGAELILCDTQLSDGDAASWLSTLKHQPEYTAIPFVMLTAVDDPQQRLQAWQCYADDYVSKNSDPGLLVVRLNALIENRR
LVQQQMLSLSLAINSVQASTSTPVLSTVETLDEQFAKRLRLVIDQHITTQELTVEFVAQQFHTSSRSLQRRVQSVFGLSY
SQYLKQTQLQIAKDALVAGHTVKEAAYYAGFTSQNYFGRVFRAEYGVTPSQFKKDASTKPPSLA
>Mature_543_residues
GMATIPSLHVSIGEALLSSFSWVLSLTIILVLSFYLAKLTRTYKAKVKSFQVELTQANKTIQSLTQQRECEQRTFGQLFT
EITKNVTWLAPYIANTQTHTDEMNALLLRINQLLESTRQWNESSRQMLSSPFLLQPWLKNQLSFEKAKSQQPLPIHISEI
PDLLVQTHLELLEKVFSKFCQDIRQSTGIAGYVLEIESKQGLRLTLTGKVEATREEYADDSYLLLKKQVEENGGELCCLH
SSQSIAQYTLCLPATVYELPQFTPDFRYLQHHVADESKAKVLIVESDPEFMDWLYYHLAADFRLTLCQTWQGAQYELDEQ
GAELILCDTQLSDGDAASWLSTLKHQPEYTAIPFVMLTAVDDPQQRLQAWQCYADDYVSKNSDPGLLVVRLNALIENRRL
VQQQMLSLSLAINSVQASTSTPVLSTVETLDEQFAKRLRLVIDQHITTQELTVEFVAQQFHTSSRSLQRRVQSVFGLSYS
QYLKQTQLQIAKDALVAGHTVKEAAYYAGFTSQNYFGRVFRAEYGVTPSQFKKDASTKPPSLA

Specific function: This Protein Is A Positive Regulator For The Phosphate Regulon. Transcription Of This Operon Is Positively Regulated By Phob And Phor When Phosphate Is Limited. [C]

COG id: COG2207

COG function: function code K; AraC-type DNA-binding domain-containing proteins

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 61817; Mature: 61686

Theoretical pI: Translated: 5.95; Mature: 5.95

Prosite motif: PS50110 RESPONSE_REGULATORY ; PS00041 HTH_ARAC_FAMILY_1 ; PS01124 HTH_ARAC_FAMILY_2

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.5 %Cys     (Translated Protein)
1.3 %Met     (Translated Protein)
2.8 %Cys+Met (Translated Protein)
1.5 %Cys     (Mature Protein)
1.1 %Met     (Mature Protein)
2.6 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MGMATIPSLHVSIGEALLSSFSWVLSLTIILVLSFYLAKLTRTYKAKVKSFQVELTQANK
CCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHEEHHHHHH
TIQSLTQQRECEQRTFGQLFTEITKNVTWLAPYIANTQTHTDEMNALLLRINQLLESTRQ
HHHHHHHHHHHHHHHHHHHHHHHHCCCEEEEHHHCCCCCCHHHHHHHHHHHHHHHHHHHH
WNESSRQMLSSPFLLQPWLKNQLSFEKAKSQQPLPIHISEIPDLLVQTHLELLEKVFSKF
HCHHHHHHHCCCCEECHHHHHHHHHHHHCCCCCCEEEHHHHHHHHHHHHHHHHHHHHHHH
CQDIRQSTGIAGYVLEIESKQGLRLTLTGKVEATREEYADDSYLLLKKQVEENGGELCCL
HHHHHHCCCCEEEEEEEECCCCEEEEEECCCCHHHHHHCCCCHHHHHHHHHCCCCCEEEE
HSSQSIAQYTLCLPATVYELPQFTPDFRYLQHHVADESKAKVLIVESDPEFMDWLYYHLA
ECCCCHHHHHHHHHHHHHHCCCCCCHHHHHHHHHCCCCCCEEEEEECCCHHHHHHHHHHH
ADFRLTLCQTWQGAQYELDEQGAELILCDTQLSDGDAASWLSTLKHQPEYTAIPFVMLTA
HHHHHEEHHCCCCCCEEECCCCCEEEEEECCCCCCCHHHHHHHHHCCCCCCEECEEEEEE
VDDPQQRLQAWQCYADDYVSKNSDPGLLVVRLNALIENRRLVQQQMLSLSLAINSVQAST
CCCHHHHHHHHHHHHHHHHCCCCCCCEEEEEHHHHHHHHHHHHHHHHHHHHHHHHHHCCC
STPVLSTVETLDEQFAKRLRLVIDQHITTQELTVEFVAQQFHTSSRSLQRRVQSVFGLSY
CCCHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHCCHHHHHHHHHHHHHCCCH
SQYLKQTQLQIAKDALVAGHTVKEAAYYAGFTSQNYFGRVFRAEYGVTPSQFKKDASTKP
HHHHHHHHHHHHHHHHHHCCHHHHHHHHCCCCCCCHHHHHHHHHCCCCHHHHHCCCCCCC
PSLA
CCCC
>Mature Secondary Structure 
GMATIPSLHVSIGEALLSSFSWVLSLTIILVLSFYLAKLTRTYKAKVKSFQVELTQANK
CCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHEEHHHHHH
TIQSLTQQRECEQRTFGQLFTEITKNVTWLAPYIANTQTHTDEMNALLLRINQLLESTRQ
HHHHHHHHHHHHHHHHHHHHHHHHCCCEEEEHHHCCCCCCHHHHHHHHHHHHHHHHHHHH
WNESSRQMLSSPFLLQPWLKNQLSFEKAKSQQPLPIHISEIPDLLVQTHLELLEKVFSKF
HCHHHHHHHCCCCEECHHHHHHHHHHHHCCCCCCEEEHHHHHHHHHHHHHHHHHHHHHHH
CQDIRQSTGIAGYVLEIESKQGLRLTLTGKVEATREEYADDSYLLLKKQVEENGGELCCL
HHHHHHCCCCEEEEEEEECCCCEEEEEECCCCHHHHHHCCCCHHHHHHHHHCCCCCEEEE
HSSQSIAQYTLCLPATVYELPQFTPDFRYLQHHVADESKAKVLIVESDPEFMDWLYYHLA
ECCCCHHHHHHHHHHHHHHCCCCCCHHHHHHHHHCCCCCCEEEEEECCCHHHHHHHHHHH
ADFRLTLCQTWQGAQYELDEQGAELILCDTQLSDGDAASWLSTLKHQPEYTAIPFVMLTA
HHHHHEEHHCCCCCCEEECCCCCEEEEEECCCCCCCHHHHHHHHHCCCCCCEECEEEEEE
VDDPQQRLQAWQCYADDYVSKNSDPGLLVVRLNALIENRRLVQQQMLSLSLAINSVQAST
CCCHHHHHHHHHHHHHHHHCCCCCCCEEEEEHHHHHHHHHHHHHHHHHHHHHHHHHHCCC
STPVLSTVETLDEQFAKRLRLVIDQHITTQELTVEFVAQQFHTSSRSLQRRVQSVFGLSY
CCCHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHCCHHHHHHHHHHHHHCCCH
SQYLKQTQLQIAKDALVAGHTVKEAAYYAGFTSQNYFGRVFRAEYGVTPSQFKKDASTKP
HHHHHHHHHHHHHHHHHHCCHHHHHHHHCCCCCCCHHHHHHHHHCCCCHHHHHCCCCCCC
PSLA
CCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA