| Definition | Serratia proteamaculans 568 chromosome, complete genome. |
|---|---|
| Accession | NC_009832 |
| Length | 5,448,853 |
Click here to switch to the map view.
The map label for this gene is yphH [H]
Identifier: 157372465
GI number: 157372465
Start: 4694577
End: 4695779
Strand: Direct
Name: yphH [H]
Synonym: Spro_4232
Alternate gene names: 157372465
Gene position: 4694577-4695779 (Clockwise)
Preceding gene: 157372453
Following gene: 157372466
Centisome position: 86.16
GC content: 56.86
Gene sequence:
>1203_bases ATGGCATTGCAAGGTTTGAATAACCAGCGGGTGCGTAATTTTAATAAACGGGTGTTATGTGCACTGCTGTACCGGGAAAA GGTCGCCAGTAAGTCGACGCTGGCGCGGCTTTCGCAGCTGTCTATTCCTGCGGTCGGCAAAATTCTCGACGAACTGCAGG AAGAGCAGCGGGTAGAACACGACCCGCACAACCTGCACAGCCGCGGTTTGGGTGGCGGCAGTTACCGCATCGCCGCCGCC GGGCAACGCATCCTGTGCCTGAATGTCTCCCCTTATCTGATTGAAAGCATCGTGGTGGATGGCCTGATGACGCCTTGCAG CGCCTTCACCCCGCAGCCGATCGTCGCCACTACGCCGCAGGCGATGCTGCAGGAAATGGTGCAAATCTATCATCTGCACA GCCGCCAGCAGGGCACGCCACTGAAGATTGCGCTGTCGATCCACGGCCAGGTCAATCCGCTGACCGGGGTGTCCCAACGT ATGCCACAGGCCCCGTGGGAAGGCCCGGTAGAGATAAAATACCTGCTGGAAGAGCGTCTGAAGACCGAGGTTTTGATCGA TAACGACTGCGTGATGCTGGGGCTGGCGGAAAAGTGGCAAAATAACGCCAATCTGCAGGACTTTTGCGTGATTAACGTCG ATTACGGCATAGGTTCATCATTTGTGATTAACCAGCAGATTTACCGGGGCAGCCTGTTTGGCAGCGGTCAAATCGGCCAT ACCATTGTCGATCCCGATGGCGGCCTTTGCTCCTGTGGCCGTTACGGCTGTCTGGAAACCATCGCTTCGCTGTCGGCGCT GAAGAAAAAGGCCCGCATTCAGCTCAAGGTCGCTCCCTGGGCACAACAGGAAGGCGAAAGGATTAAAACCCCCACCACCG CCGACCTGATTGCCCGTTATCATCAGGGCGATGCTGCGTTGCAGGTGCTGGTGCAACGCGCCGCCCAGGCGATTGGCCTG AGCCTGTATAACTTCCTTAATATCCTCAATATCAACCGTATCTATCTGTACGGGCGCAGCTGTGGATTTGGTCAGGCCTG GCTGGACACCATCATCAGTCAGACCGGTTTTAACCCTTTCGACCGGCACGACCAGATCCAGGCCCAGGCCACGCATATCG GCTTTGGCCAACTGACGCGCGCGCAGCAGGTGACGGGGATAGGCTATCTGTATGTCGAACAGGCACTGACGGAGATGCTA TGA
Upstream 100 bases:
>100_bases TCTCTAAAAATACTGAACATTGCGTTTCAGGCAGTCTAGATGACGGAATTGATGACTTTATGCGCTACCATCACGCAATA CACTAAACGGGGTTTAATAA
Downstream 100 bases:
>100_bases TGCCCGACTTTATCCCAGTAAAAACAATACGGAGCACCATGAACCCCACTCTACGACTCTGGTCACGCGCAGGCATTGTC TGCCTGATGCTGATCCTGGC
Product: ROK family protein
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 400; Mature: 399
Protein sequence:
>400_residues MALQGLNNQRVRNFNKRVLCALLYREKVASKSTLARLSQLSIPAVGKILDELQEEQRVEHDPHNLHSRGLGGGSYRIAAA GQRILCLNVSPYLIESIVVDGLMTPCSAFTPQPIVATTPQAMLQEMVQIYHLHSRQQGTPLKIALSIHGQVNPLTGVSQR MPQAPWEGPVEIKYLLEERLKTEVLIDNDCVMLGLAEKWQNNANLQDFCVINVDYGIGSSFVINQQIYRGSLFGSGQIGH TIVDPDGGLCSCGRYGCLETIASLSALKKKARIQLKVAPWAQQEGERIKTPTTADLIARYHQGDAALQVLVQRAAQAIGL SLYNFLNILNINRIYLYGRSCGFGQAWLDTIISQTGFNPFDRHDQIQAQATHIGFGQLTRAQQVTGIGYLYVEQALTEML
Sequences:
>Translated_400_residues MALQGLNNQRVRNFNKRVLCALLYREKVASKSTLARLSQLSIPAVGKILDELQEEQRVEHDPHNLHSRGLGGGSYRIAAA GQRILCLNVSPYLIESIVVDGLMTPCSAFTPQPIVATTPQAMLQEMVQIYHLHSRQQGTPLKIALSIHGQVNPLTGVSQR MPQAPWEGPVEIKYLLEERLKTEVLIDNDCVMLGLAEKWQNNANLQDFCVINVDYGIGSSFVINQQIYRGSLFGSGQIGH TIVDPDGGLCSCGRYGCLETIASLSALKKKARIQLKVAPWAQQEGERIKTPTTADLIARYHQGDAALQVLVQRAAQAIGL SLYNFLNILNINRIYLYGRSCGFGQAWLDTIISQTGFNPFDRHDQIQAQATHIGFGQLTRAQQVTGIGYLYVEQALTEML >Mature_399_residues ALQGLNNQRVRNFNKRVLCALLYREKVASKSTLARLSQLSIPAVGKILDELQEEQRVEHDPHNLHSRGLGGGSYRIAAAG QRILCLNVSPYLIESIVVDGLMTPCSAFTPQPIVATTPQAMLQEMVQIYHLHSRQQGTPLKIALSIHGQVNPLTGVSQRM PQAPWEGPVEIKYLLEERLKTEVLIDNDCVMLGLAEKWQNNANLQDFCVINVDYGIGSSFVINQQIYRGSLFGSGQIGHT IVDPDGGLCSCGRYGCLETIASLSALKKKARIQLKVAPWAQQEGERIKTPTTADLIARYHQGDAALQVLVQRAAQAIGLS LYNFLNILNINRIYLYGRSCGFGQAWLDTIISQTGFNPFDRHDQIQAQATHIGFGQLTRAQQVTGIGYLYVEQALTEML
Specific function: Unknown
COG id: COG1940
COG function: function code KG; Transcriptional regulator/sugar kinase
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the ROK (nagC/xylR) family [H]
Homologues:
Organism=Homo sapiens, GI298566315, Length=205, Percent_Identity=30.7317073170732, Blast_Score=79, Evalue=9e-15, Organism=Homo sapiens, GI298566325, Length=205, Percent_Identity=30.7317073170732, Blast_Score=79, Evalue=1e-14, Organism=Homo sapiens, GI4885285, Length=205, Percent_Identity=30.7317073170732, Blast_Score=78, Evalue=1e-14, Organism=Homo sapiens, GI190014632, Length=205, Percent_Identity=30.7317073170732, Blast_Score=78, Evalue=1e-14, Organism=Escherichia coli, GI87082127, Length=396, Percent_Identity=60.3535353535353, Blast_Score=480, Evalue=1e-137, Organism=Escherichia coli, GI1786891, Length=235, Percent_Identity=27.2340425531915, Blast_Score=87, Evalue=2e-18, Organism=Escherichia coli, GI1787878, Length=374, Percent_Identity=23.2620320855615, Blast_Score=75, Evalue=6e-15,
Paralogues:
None
Copy number: 10-20 Molecules/Cell [C]
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR000600 - InterPro: IPR011991 [H]
Pfam domain/function: PF00480 ROK [H]
EC number: NA
Molecular weight: Translated: 44253; Mature: 44121
Theoretical pI: Translated: 8.15; Mature: 8.15
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
2.2 %Cys (Translated Protein) 1.8 %Met (Translated Protein) 4.0 %Cys+Met (Translated Protein) 2.3 %Cys (Mature Protein) 1.5 %Met (Mature Protein) 3.8 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MALQGLNNQRVRNFNKRVLCALLYREKVASKSTLARLSQLSIPAVGKILDELQEEQRVEH CCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHCCC DPHNLHSRGLGGGSYRIAAAGQRILCLNVSPYLIESIVVDGLMTPCSAFTPQPIVATTPQ CCCHHHHCCCCCCCEEEEECCCEEEEEECCHHHHHHHHHHHHCCCCCCCCCCCCEECCHH AMLQEMVQIYHLHSRQQGTPLKIALSIHGQVNPLTGVSQRMPQAPWEGPVEIKYLLEERL HHHHHHHHHHHHHCCCCCCCEEEEEEECCCCCCCCCHHHHCCCCCCCCCHHHHHHHHHHH KTEVLIDNDCVMLGLAEKWQNNANLQDFCVINVDYGIGSSFVINQQIYRGSLFGSGQIGH HHEEEECCCEEEEEEHHHHCCCCCCCEEEEEEECCCCCCCEEEEHHHHCCCCCCCCCCCC TIVDPDGGLCSCGRYGCLETIASLSALKKKARIQLKVAPWAQQEGERIKTPTTADLIARY EEECCCCCEECCCCHHHHHHHHHHHHHHHHHEEEEEECCCCCCCCCCCCCCCHHHHHHHH HQGDAALQVLVQRAAQAIGLSLYNFLNILNINRIYLYGRSCGFGQAWLDTIISQTGFNPF CCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCCEEEEEECCCCCCHHHHHHHHHHCCCCCC DRHDQIQAQATHIGFGQLTRAQQVTGIGYLYVEQALTEML CCCCHHHHHHEECCHHHHHHHHHHCCCHHHHHHHHHHHHC >Mature Secondary Structure ALQGLNNQRVRNFNKRVLCALLYREKVASKSTLARLSQLSIPAVGKILDELQEEQRVEH CCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHCCC DPHNLHSRGLGGGSYRIAAAGQRILCLNVSPYLIESIVVDGLMTPCSAFTPQPIVATTPQ CCCHHHHCCCCCCCEEEEECCCEEEEEECCHHHHHHHHHHHHCCCCCCCCCCCCEECCHH AMLQEMVQIYHLHSRQQGTPLKIALSIHGQVNPLTGVSQRMPQAPWEGPVEIKYLLEERL HHHHHHHHHHHHHCCCCCCCEEEEEEECCCCCCCCCHHHHCCCCCCCCCHHHHHHHHHHH KTEVLIDNDCVMLGLAEKWQNNANLQDFCVINVDYGIGSSFVINQQIYRGSLFGSGQIGH HHEEEECCCEEEEEEHHHHCCCCCCCEEEEEEECCCCCCCEEEEHHHHCCCCCCCCCCCC TIVDPDGGLCSCGRYGCLETIASLSALKKKARIQLKVAPWAQQEGERIKTPTTADLIARY EEECCCCCEECCCCHHHHHHHHHHHHHHHHHEEEEEECCCCCCCCCCCCCCCHHHHHHHH HQGDAALQVLVQRAAQAIGLSLYNFLNILNINRIYLYGRSCGFGQAWLDTIISQTGFNPF CCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCCEEEEEECCCCCCHHHHHHHHHHCCCCCC DRHDQIQAQATHIGFGQLTRAQQVTGIGYLYVEQALTEML CCCCHHHHHHEECCHHHHHHHHHHCCCHHHHHHHHHHHHC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 9205837; 9278503 [H]