| Definition | Geobacter sulfurreducens PCA chromosome, complete genome. |
|---|---|
| Accession | NC_002939 |
| Length | 3,814,139 |
Click here to switch to the map view.
The map label for this gene is cph1 [H]
Identifier: 39998082
GI number: 39998082
Start: 3282674
End: 3284707
Strand: Reverse
Name: cph1 [H]
Synonym: GSU2991
Alternate gene names: 39998082
Gene position: 3284707-3282674 (Counterclockwise)
Preceding gene: 308513333
Following gene: 39998081
Centisome position: 86.12
GC content: 63.52
Gene sequence:
>2034_bases GTGACCATAAAACGGAAAGTGCAAATCGTCATCATCCTGATCGCAATACATGTTGCAGTGTTCGTGGGATACCTGTTTCA CTCGTCGGCCCAGGTCCATACGCGGGTGCGCCATCTCATCCCGGCGGTCGAATACCTGAGGGGCATTGCCCTGGCCCGGG CCGGCATGATTCAGCAGATGAAGGAGGTGGTCGATTATCTGGCCATCTCCGATCCTGCCGCCCGGGATGAATTCCGCAAG GGCGGCCAGTTGGCCGATGAGTCCTTTTCCGTCTGGATCGATGCCATCAAGGCGCAGAGGGCGCTGGGCGTTGCCGGCGA GGACGACGATCTTGAACTGGTCCAGGAGGTGCAGACCCGCTATGCCTCATGGGTTCGCACGGCCGAATGGTTTTTTGAGC TCCAGGACGCGGGCCGCGGCGATGAGGCGATGGCGCTGTTCCGCGATCGGCTTGAGCCCTATTTCGATCGGGAGGTGCTC CTGCCCGTGGACAAGGCCCTCGATGACGGAGCGGTGGAGGTGCACGTCGCCTTTCACAATCTATTAATGGCCGTGGGGCG GATCCCCTGGATGTCCGCGGAGGGAGTCCGGAACATCGAGCGGGGCGAAGCGGCCCTGGACGGCTTTCTTGCCGCCAACC ACCTGCTGTTCGAGGTGACCGGGCAGCTCAAGGAGCTGATGAAGTATCTGCTCAACCAGCGCCAGGGCATCGAGACCGAT CTTTCGCGGCTGGACTGGCAGGCCGGCCATGCCCTGGAGAATTTCCGGCAGCAGATGTGGAGCCTGGCACGCCAGGGTGA CCCGACGGCATTGAAGGACGCTGAGACCGTTACACGGAGCTTCCAGGAGCTGACCGGGCTCATGCATCAGGCCGTGGCGC TCAAAAGGGCTGGGCGCGGGCATGAGGCGGTGGCTCTGGCCAACTCCCGCATGGAGGCGGTTCTCTACAAGACGCTCATG CCCATCATTTCCCGATCGCTGGATTCGGGCAGTGCCCAGATGCTCACCCTGACCGCCGCGGCCCGCTGGCAGGGCGTTCT TGCCGTTTCGCTCTTCCTGGTGATGGCGGTGAGCCTCATCCTCGGAACGAGCCGGTCCGTTCTCCGGGCCCTGGATTCGC TCATGGCCGGTACCTCGGCCATTGCCGAAGGGGATTTCTCCCACCGGCTCGATGCCCGGCGTTCGGACGAGCTGGGCGCC CTTGCCGTCTCCTTCAACACCATGGTGGAGCGCCTCCAGAAATCCCGACGCGACCTGGACTCGTTCGCCCGGCTTCTGGA GCAGCGAGTGTACGACCGGACCGTCCAGCTGGAAGAGGCGAACGAGGATCTGAGGCAATTCAGTTCATCCCTGAGCCATG ATATCCGAACGCCCCTGTCGAGCATCGCCGGCTACGTGCAACTGGCGCGCGCCGAATGCGACGGCACCGAGAGCGAGCTG CTGCCGGATTTATTCACGGCCATTGAGCTTGCCACGGCAAGGATGAACGCCCTCGTCGACGCGCAGCTCGCCCTTGCCCG CGCCACCTGCAAGGAGTTGAACCTCGAGCCGGTGGACATGGCGGAAATAGGTCAGGCCGTGATAGATAACCTCCAATTCG CCGAGCCGCAACGGAAGGTAGGCTTCCAGGTGGCGGGCGATCTGACTGTGGATGGGGACATGGACCTGCTGGGCCTTGCG GTGGAGAACCTGCTCAGCAACGCGTGGAAGTACACGGCCATCAGGGATGAAGCCGTCATCGAGTTCGGGTCCCGGGACGA GGGGGATCGGCGGATTTACTTTGTCCGCGATAACGGTGCGGGATTCGATCCGGAGGAGATCAATCGTCTCTTCCGACCCT TCAGCCGGCTGCATGCAGCCGAGCAGTTCCCGGGGACCGGCGTCGGCCTCGCCACCGTGGCTCGGGTGATCCGCCGGCAC GGTGGCCGCACCTGGGCCGAAGGTGCCGTGGACCGGGGTGCCACGTTCTTCTTTACGCTCAACGAAACGCCGCTGCCGGT GGTTGTGCCGCCACAGCCGGAGGAGAGCGCGTGA
Upstream 100 bases:
>100_bases CGCGCACCTGGAGAAGCATCTGAACATTGATCGCATGCTGGAACTCTGCGGCCTCGGCGGGATGTTGCCGGAGTAGTGGT CTTTTCAGAGGAGATTCCCC
Downstream 100 bases:
>100_bases CCGGCCCTGACCGGGTGGCCCTGCTGGTCCTTGCCGCCCTTGTTCTCGACTGGCTGCTGGGCGATCCTCGCTGGCTCCCC CATCCGGTGGTGGCCGTGGG
Product: sensor histidine kinase
Products: NA
Alternate protein names: Bacteriophytochrome cph1; Light-regulated histidine kinase 1 [H]
Number of amino acids: Translated: 677; Mature: 676
Protein sequence:
>677_residues MTIKRKVQIVIILIAIHVAVFVGYLFHSSAQVHTRVRHLIPAVEYLRGIALARAGMIQQMKEVVDYLAISDPAARDEFRK GGQLADESFSVWIDAIKAQRALGVAGEDDDLELVQEVQTRYASWVRTAEWFFELQDAGRGDEAMALFRDRLEPYFDREVL LPVDKALDDGAVEVHVAFHNLLMAVGRIPWMSAEGVRNIERGEAALDGFLAANHLLFEVTGQLKELMKYLLNQRQGIETD LSRLDWQAGHALENFRQQMWSLARQGDPTALKDAETVTRSFQELTGLMHQAVALKRAGRGHEAVALANSRMEAVLYKTLM PIISRSLDSGSAQMLTLTAAARWQGVLAVSLFLVMAVSLILGTSRSVLRALDSLMAGTSAIAEGDFSHRLDARRSDELGA LAVSFNTMVERLQKSRRDLDSFARLLEQRVYDRTVQLEEANEDLRQFSSSLSHDIRTPLSSIAGYVQLARAECDGTESEL LPDLFTAIELATARMNALVDAQLALARATCKELNLEPVDMAEIGQAVIDNLQFAEPQRKVGFQVAGDLTVDGDMDLLGLA VENLLSNAWKYTAIRDEAVIEFGSRDEGDRRIYFVRDNGAGFDPEEINRLFRPFSRLHAAEQFPGTGVGLATVARVIRRH GGRTWAEGAVDRGATFFFTLNETPLPVVVPPQPEESA
Sequences:
>Translated_677_residues MTIKRKVQIVIILIAIHVAVFVGYLFHSSAQVHTRVRHLIPAVEYLRGIALARAGMIQQMKEVVDYLAISDPAARDEFRK GGQLADESFSVWIDAIKAQRALGVAGEDDDLELVQEVQTRYASWVRTAEWFFELQDAGRGDEAMALFRDRLEPYFDREVL LPVDKALDDGAVEVHVAFHNLLMAVGRIPWMSAEGVRNIERGEAALDGFLAANHLLFEVTGQLKELMKYLLNQRQGIETD LSRLDWQAGHALENFRQQMWSLARQGDPTALKDAETVTRSFQELTGLMHQAVALKRAGRGHEAVALANSRMEAVLYKTLM PIISRSLDSGSAQMLTLTAAARWQGVLAVSLFLVMAVSLILGTSRSVLRALDSLMAGTSAIAEGDFSHRLDARRSDELGA LAVSFNTMVERLQKSRRDLDSFARLLEQRVYDRTVQLEEANEDLRQFSSSLSHDIRTPLSSIAGYVQLARAECDGTESEL LPDLFTAIELATARMNALVDAQLALARATCKELNLEPVDMAEIGQAVIDNLQFAEPQRKVGFQVAGDLTVDGDMDLLGLA VENLLSNAWKYTAIRDEAVIEFGSRDEGDRRIYFVRDNGAGFDPEEINRLFRPFSRLHAAEQFPGTGVGLATVARVIRRH GGRTWAEGAVDRGATFFFTLNETPLPVVVPPQPEESA >Mature_676_residues TIKRKVQIVIILIAIHVAVFVGYLFHSSAQVHTRVRHLIPAVEYLRGIALARAGMIQQMKEVVDYLAISDPAARDEFRKG GQLADESFSVWIDAIKAQRALGVAGEDDDLELVQEVQTRYASWVRTAEWFFELQDAGRGDEAMALFRDRLEPYFDREVLL PVDKALDDGAVEVHVAFHNLLMAVGRIPWMSAEGVRNIERGEAALDGFLAANHLLFEVTGQLKELMKYLLNQRQGIETDL SRLDWQAGHALENFRQQMWSLARQGDPTALKDAETVTRSFQELTGLMHQAVALKRAGRGHEAVALANSRMEAVLYKTLMP IISRSLDSGSAQMLTLTAAARWQGVLAVSLFLVMAVSLILGTSRSVLRALDSLMAGTSAIAEGDFSHRLDARRSDELGAL AVSFNTMVERLQKSRRDLDSFARLLEQRVYDRTVQLEEANEDLRQFSSSLSHDIRTPLSSIAGYVQLARAECDGTESELL PDLFTAIELATARMNALVDAQLALARATCKELNLEPVDMAEIGQAVIDNLQFAEPQRKVGFQVAGDLTVDGDMDLLGLAV ENLLSNAWKYTAIRDEAVIEFGSRDEGDRRIYFVRDNGAGFDPEEINRLFRPFSRLHAAEQFPGTGVGLATVARVIRRHG GRTWAEGAVDRGATFFFTLNETPLPVVVPPQPEESA
Specific function: Regulatory photoreceptor which exists in two forms that are reversibly interconvertible by light:the R form that absorbs maximally in the red region of the spectrum and the FR form that absorbs maximally in the far-red region. Has also a slight blue shift
COG id: COG0642
COG function: function code T; Signal transduction histidine kinase
Gene ontology:
Cell location: Integral Membrane Protein. Inner Membrane [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 1 PAS (PER-ARNT-SIM) domain [H]
Homologues:
Organism=Escherichia coli, GI1786783, Length=319, Percent_Identity=29.153605015674, Blast_Score=91, Evalue=2e-19, Organism=Escherichia coli, GI1788393, Length=291, Percent_Identity=27.4914089347079, Blast_Score=89, Evalue=9e-19, Organism=Escherichia coli, GI1786600, Length=232, Percent_Identity=29.7413793103448, Blast_Score=87, Evalue=5e-18, Organism=Escherichia coli, GI87081816, Length=376, Percent_Identity=27.3936170212766, Blast_Score=86, Evalue=6e-18, Organism=Escherichia coli, GI145693157, Length=231, Percent_Identity=28.1385281385281, Blast_Score=79, Evalue=1e-15, Organism=Escherichia coli, GI1790346, Length=258, Percent_Identity=29.4573643410853, Blast_Score=76, Evalue=8e-15, Organism=Escherichia coli, GI1786912, Length=223, Percent_Identity=30.0448430493274, Blast_Score=72, Evalue=9e-14, Organism=Escherichia coli, GI48994928, Length=257, Percent_Identity=28.0155642023346, Blast_Score=72, Evalue=1e-13, Organism=Escherichia coli, GI1789808, Length=197, Percent_Identity=30.4568527918782, Blast_Score=70, Evalue=3e-13, Organism=Escherichia coli, GI1789149, Length=343, Percent_Identity=22.7405247813411, Blast_Score=70, Evalue=4e-13, Organism=Escherichia coli, GI1790861, Length=235, Percent_Identity=29.7872340425532, Blast_Score=69, Evalue=1e-12, Organism=Escherichia coli, GI1788549, Length=247, Percent_Identity=25.9109311740891, Blast_Score=69, Evalue=1e-12, Organism=Escherichia coli, GI1790551, Length=316, Percent_Identity=24.0506329113924, Blast_Score=67, Evalue=3e-12, Organism=Escherichia coli, GI1788713, Length=228, Percent_Identity=26.7543859649123, Blast_Score=67, Evalue=3e-12, Organism=Escherichia coli, GI1790436, Length=221, Percent_Identity=26.6968325791855, Blast_Score=64, Evalue=4e-11,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR003594 - InterPro: IPR003018 - InterPro: IPR000014 - InterPro: IPR013654 - InterPro: IPR016132 - InterPro: IPR001294 - InterPro: IPR013515 - InterPro: IPR003661 - InterPro: IPR005467 - InterPro: IPR009082 [H]
Pfam domain/function: PF01590 GAF; PF02518 HATPase_c; PF00512 HisKA; PF08446 PAS_2; PF00360 Phytochrome [H]
EC number: =2.7.13.3 [H]
Molecular weight: Translated: 75119; Mature: 74987
Theoretical pI: Translated: 4.98; Mature: 4.98
Prosite motif: PS50885 HAMP ; PS50109 HIS_KIN
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.3 %Cys (Translated Protein) 2.7 %Met (Translated Protein) 3.0 %Cys+Met (Translated Protein) 0.3 %Cys (Mature Protein) 2.5 %Met (Mature Protein) 2.8 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MTIKRKVQIVIILIAIHVAVFVGYLFHSSAQVHTRVRHLIPAVEYLRGIALARAGMIQQM CCCCHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH KEVVDYLAISDPAARDEFRKGGQLADESFSVWIDAIKAQRALGVAGEDDDLELVQEVQTR HHHHHHHHCCCCHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHH YASWVRTAEWFFELQDAGRGDEAMALFRDRLEPYFDREVLLPVDKALDDGAVEVHVAFHN HHHHHHHHHHHHHHHHCCCCHHHHHHHHHHCCHHCCCCEECCHHHCCCCCCEEEHHHHHH LLMAVGRIPWMSAEGVRNIERGEAALDGFLAANHLLFEVTGQLKELMKYLLNQRQGIETD HHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHH LSRLDWQAGHALENFRQQMWSLARQGDPTALKDAETVTRSFQELTGLMHQAVALKRAGRG HHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCC HEAVALANSRMEAVLYKTLMPIISRSLDSGSAQMLTLTAAARWQGVLAVSLFLVMAVSLI CHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCEEEEEEHHHHHHHHHHHHHHHHHHHHHH LGTSRSVLRALDSLMAGTSAIAEGDFSHRLDARRSDELGALAVSFNTMVERLQKSRRDLD HCCCHHHHHHHHHHHHCCHHHHCCCHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHHHH SFARLLEQRVYDRTVQLEEANEDLRQFSSSLSHDIRTPLSSIAGYVQLARAECDGTESEL HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHH LPDLFTAIELATARMNALVDAQLALARATCKELNLEPVDMAEIGQAVIDNLQFAEPQRKV HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHCCCCCCHHHHC GFQVAGDLTVDGDMDLLGLAVENLLSNAWKYTAIRDEAVIEFGSRDEGDRRIYFVRDNGA CCEEECCEEECCCHHHHHHHHHHHHHCCHHHHEECHHHHHCCCCCCCCCCEEEEEECCCC GFDPEEINRLFRPFSRLHAAEQFPGTGVGLATVARVIRRHGGRTWAEGAVDRGATFFFTL CCCHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHCCCCCHHHHHHCCCCEEEEEE NETPLPVVVPPQPEESA CCCCCEEEECCCCCCCC >Mature Secondary Structure TIKRKVQIVIILIAIHVAVFVGYLFHSSAQVHTRVRHLIPAVEYLRGIALARAGMIQQM CCCHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH KEVVDYLAISDPAARDEFRKGGQLADESFSVWIDAIKAQRALGVAGEDDDLELVQEVQTR HHHHHHHHCCCCHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHH YASWVRTAEWFFELQDAGRGDEAMALFRDRLEPYFDREVLLPVDKALDDGAVEVHVAFHN HHHHHHHHHHHHHHHHCCCCHHHHHHHHHHCCHHCCCCEECCHHHCCCCCCEEEHHHHHH LLMAVGRIPWMSAEGVRNIERGEAALDGFLAANHLLFEVTGQLKELMKYLLNQRQGIETD HHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHH LSRLDWQAGHALENFRQQMWSLARQGDPTALKDAETVTRSFQELTGLMHQAVALKRAGRG HHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCC HEAVALANSRMEAVLYKTLMPIISRSLDSGSAQMLTLTAAARWQGVLAVSLFLVMAVSLI CHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCEEEEEEHHHHHHHHHHHHHHHHHHHHHH LGTSRSVLRALDSLMAGTSAIAEGDFSHRLDARRSDELGALAVSFNTMVERLQKSRRDLD HCCCHHHHHHHHHHHHCCHHHHCCCHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHHHH SFARLLEQRVYDRTVQLEEANEDLRQFSSSLSHDIRTPLSSIAGYVQLARAECDGTESEL HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHH LPDLFTAIELATARMNALVDAQLALARATCKELNLEPVDMAEIGQAVIDNLQFAEPQRKV HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHCCCCCCHHHHC GFQVAGDLTVDGDMDLLGLAVENLLSNAWKYTAIRDEAVIEFGSRDEGDRRIYFVRDNGA CCEEECCEEECCCHHHHHHHHHHHHHCCHHHHEECHHHHHCCCCCCCCCCEEEEEECCCC GFDPEEINRLFRPFSRLHAAEQFPGTGVGLATVARVIRRHGGRTWAEGAVDRGATFFFTL CCCHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHCCCCCHHHHHHCCCCEEEEEE NETPLPVVVPPQPEESA CCCCCEEEECCCCCCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 6.0
TargetDB status: NA
Availability: NA
References: 8590279; 8905231; 9109482; 9278513; 10828948 [H]