Definition Escherichia coli E24377A, complete genome.
Accession NC_009801
Length 4,979,619

Click here to switch to the map view.

The map label for this gene is rhaB

Identifier: 157155428

GI number: 157155428

Start: 4423652

End: 4425121

Strand: Reverse

Name: rhaB

Synonym: EcE24377A_4435

Alternate gene names: 157155428

Gene position: 4425121-4423652 (Counterclockwise)

Preceding gene: 157157534

Following gene: 157154741

Centisome position: 88.86

GC content: 55.24

Gene sequence:

>1470_bases
ATGACCTTTCGCAATTGTGTCGCCGTCGATCTCGGCGCATCCAGTGGGCGCGTGATGCTGGCGCGTTACGAGCGTGAATG
CCGCAGCCTGACGCTGCGCGAAATCCATCGTTTTAAAAATGGGCTGCATAGCCAGAACGGTTATGTCACCTGGAATGTGG
ATAGCCTGGAAAGTGCCATTCGCCTTGGATTAAACAAGGTGTGCGAGGAAGGGATTCGTATCGATAGCATTGGGATTGAT
ACCTGGGGCGTGGACTTTGTGCTGCTCGACCAACAGGGTCAGCGTGTGGGCCTGCCCGTTGCTTATCGCGATAGCCGCTC
CAATGGCCTAATGGCGCAGGCACAGCAACAACTCGGCAAACGCGATATTTATCAACGTAGCGGCATCCAGTTTCTGCCCT
TCAATACGCTTTATCAACTGCGTGCGCTGACGGAGCAACAACCTGAACTTATTCCACACATTGCTCACGCTCTGCTGATG
CCGGATTACTTCAGCTATCGCCTGACCGGCAAGATGAACTGGGAGTACACCAATGCCACCACCACACAACTGGTCAATAT
CAATAGCGACGACTGGGACGAGTCGCTACTGGCGTGGAGCGGGGCCAACAAAGCCTGGTTTGGTCGCCCGACGCATCCGG
GTAATGTCATTGGGCACTGGATTTGCCCGCAGGGTAATGAGATTCCGGTGGTCGCCGTTGCCAGCCATGATACCGCCAGC
GCGGTTATCGCCTCGCCGTTAAACGGTTCACGCGCCGCTTATCTCTCTTCTGGCACCTGGTCATTGATGGGCTTCGAAAG
CCAGACGCCATTTACCAATGACACGGCGCTGGCAGCCAACATCACCAATGAAGGCGGGGCGGAAGGTCGCTATCGGGTGC
TGAAAAATATTATGGGCTTATGGCTGCTTCAGCGAGTGCTTCAGGAACGGCAAATCAACGATCTCCCGGCGCTTATCGCC
GCGACACAGGCACTTCCGGCCTGTCGCTTCATCATCAATCCCAATGACGATCGCTTTATTAATCCTGAAGCGATGTGCAG
CGAAATTCAGGCTGCGTGTCGGGAAACGGCGCAACCGATCCCGGAAAGTGATGCTGAACTGGCGCGCTGTATTTTCGACA
GTCTGGCGCTGCTGTATGCCGATGTGTTGCATGAGCTGGCGCAGCTGCGCGGTGAAGATTTCTCGCAACTGCATATTGTC
GGCGGCGGCTGCCAGAACACGCTGCTCAACCAGCTATGCGCCGATGCCTGCGGTATTCGGGTGATCGCCGGGCCTGTTGA
AGCCTCAACGCTCGGCAATATCGGCATCCAGTTAATGACGCTGGATGAACTCAACAATGTGGATGATTTCCGTCAGGTCG
TCAGCACCACCGCGAATCTGACCACCTTTACCCCTAATCCTGACAGTGAAATTGCCCACTATGTGGCGCAGATTCACTCT
ACACGACAGACAAAGGAGCTTTGCGCATGA

Upstream 100 bases:

>100_bases
TCCCTGGTTGCCAATGGCCCATTTTCCTGTCAGTAGCGAGAAGGTCGCGAATTCAGGCGCTTTTTAGACTGGTCGTAATG
AAATTCAGCAGGATCACATT

Downstream 100 bases:

>100_bases
CCACTCAACTGGAACAGGCCTGGGAGCTGGCGAAACAGCGTTTCGCGGCGGTGGGGATTGATGTCGAGGAGGCGCTGCGC
CAACTTGATCGTTTACCCGT

Product: rhamnulokinase

Products: NA

Alternate protein names: Rhamnulose kinase

Number of amino acids: Translated: 489; Mature: 488

Protein sequence:

>489_residues
MTFRNCVAVDLGASSGRVMLARYERECRSLTLREIHRFKNGLHSQNGYVTWNVDSLESAIRLGLNKVCEEGIRIDSIGID
TWGVDFVLLDQQGQRVGLPVAYRDSRSNGLMAQAQQQLGKRDIYQRSGIQFLPFNTLYQLRALTEQQPELIPHIAHALLM
PDYFSYRLTGKMNWEYTNATTTQLVNINSDDWDESLLAWSGANKAWFGRPTHPGNVIGHWICPQGNEIPVVAVASHDTAS
AVIASPLNGSRAAYLSSGTWSLMGFESQTPFTNDTALAANITNEGGAEGRYRVLKNIMGLWLLQRVLQERQINDLPALIA
ATQALPACRFIINPNDDRFINPEAMCSEIQAACRETAQPIPESDAELARCIFDSLALLYADVLHELAQLRGEDFSQLHIV
GGGCQNTLLNQLCADACGIRVIAGPVEASTLGNIGIQLMTLDELNNVDDFRQVVSTTANLTTFTPNPDSEIAHYVAQIHS
TRQTKELCA

Sequences:

>Translated_489_residues
MTFRNCVAVDLGASSGRVMLARYERECRSLTLREIHRFKNGLHSQNGYVTWNVDSLESAIRLGLNKVCEEGIRIDSIGID
TWGVDFVLLDQQGQRVGLPVAYRDSRSNGLMAQAQQQLGKRDIYQRSGIQFLPFNTLYQLRALTEQQPELIPHIAHALLM
PDYFSYRLTGKMNWEYTNATTTQLVNINSDDWDESLLAWSGANKAWFGRPTHPGNVIGHWICPQGNEIPVVAVASHDTAS
AVIASPLNGSRAAYLSSGTWSLMGFESQTPFTNDTALAANITNEGGAEGRYRVLKNIMGLWLLQRVLQERQINDLPALIA
ATQALPACRFIINPNDDRFINPEAMCSEIQAACRETAQPIPESDAELARCIFDSLALLYADVLHELAQLRGEDFSQLHIV
GGGCQNTLLNQLCADACGIRVIAGPVEASTLGNIGIQLMTLDELNNVDDFRQVVSTTANLTTFTPNPDSEIAHYVAQIHS
TRQTKELCA
>Mature_488_residues
TFRNCVAVDLGASSGRVMLARYERECRSLTLREIHRFKNGLHSQNGYVTWNVDSLESAIRLGLNKVCEEGIRIDSIGIDT
WGVDFVLLDQQGQRVGLPVAYRDSRSNGLMAQAQQQLGKRDIYQRSGIQFLPFNTLYQLRALTEQQPELIPHIAHALLMP
DYFSYRLTGKMNWEYTNATTTQLVNINSDDWDESLLAWSGANKAWFGRPTHPGNVIGHWICPQGNEIPVVAVASHDTASA
VIASPLNGSRAAYLSSGTWSLMGFESQTPFTNDTALAANITNEGGAEGRYRVLKNIMGLWLLQRVLQERQINDLPALIAA
TQALPACRFIINPNDDRFINPEAMCSEIQAACRETAQPIPESDAELARCIFDSLALLYADVLHELAQLRGEDFSQLHIVG
GGCQNTLLNQLCADACGIRVIAGPVEASTLGNIGIQLMTLDELNNVDDFRQVVSTTANLTTFTPNPDSEIAHYVAQIHST
RQTKELCA

Specific function: Metabolism of L-rhamnose; second step. [C]

COG id: COG1070

COG function: function code G; Sugar (pentulose and hexulose) kinases

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the rhamnulokinase family

Homologues:

Organism=Escherichia coli, GI1790338, Length=489, Percent_Identity=98.7730061349693, Blast_Score=1004, Evalue=0.0,
Organism=Escherichia coli, GI1789168, Length=417, Percent_Identity=25.1798561151079, Blast_Score=89, Evalue=5e-19,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): RHAB_ECO24 (A7ZUB5)

Other databases:

- EMBL:   CP000800
- RefSeq:   YP_001465394.1
- ProteinModelPortal:   A7ZUB5
- SMR:   A7ZUB5
- STRING:   A7ZUB5
- EnsemblBacteria:   EBESCT00000020390
- GeneID:   5589027
- GenomeReviews:   CP000800_GR
- KEGG:   ecw:EcE24377A_4435
- eggNOG:   COG1070
- GeneTree:   EBGT00050000009230
- HOGENOM:   HBG313195
- OMA:   EEIHRFK
- ProtClustDB:   PRK10640
- BioCyc:   ECOL331111:ECE24377A_4435-MONOMER
- HAMAP:   MF_01535
- InterPro:   IPR000577
- InterPro:   IPR018485
- InterPro:   IPR018484
- InterPro:   IPR013449
- PANTHER:   PTHR10196
- TIGRFAMs:   TIGR02627

Pfam domain/function: PF02782 FGGY_C; PF00370 FGGY_N

EC number: =2.7.1.5

Molecular weight: Translated: 54051; Mature: 53920

Theoretical pI: Translated: 5.05; Mature: 5.05

Prosite motif: NA

Important sites: BINDING 14-14 BINDING 259-259 BINDING 296-296 BINDING 304-304

Signals:

None

Transmembrane regions:

None

Cys/Met content:

2.5 %Cys     (Translated Protein)
1.8 %Met     (Translated Protein)
4.3 %Cys+Met (Translated Protein)
2.5 %Cys     (Mature Protein)
1.6 %Met     (Mature Protein)
4.1 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MTFRNCVAVDLGASSGRVMLARYERECRSLTLREIHRFKNGLHSQNGYVTWNVDSLESAI
CCCCCEEEEEECCCCCCEEHHHHHHHHHHHHHHHHHHHHHCCCCCCCEEEEEHHHHHHHH
RLGLNKVCEEGIRIDSIGIDTWGVDFVLLDQQGQRVGLPVAYRDSRSNGLMAQAQQQLGK
HHHHHHHHHCCCEEEEECCCCCCCEEEEECCCCCEECCEEEECCCCCCCHHHHHHHHHHH
RDIYQRSGIQFLPFNTLYQLRALTEQQPELIPHIAHALLMPDYFSYRLTGKMNWEYTNAT
HHHHHHCCCEEECHHHHHHHHHHHHCCHHHHHHHHHHHHCCCCCCEEEEEEEEEEECCCC
TTQLVNINSDDWDESLLAWSGANKAWFGRPTHPGNVIGHWICPQGNEIPVVAVASHDTAS
EEEEEECCCCCCCCHHHEECCCCCCCCCCCCCCCCCEEEEECCCCCCCCEEEEECCCCCC
AVIASPLNGSRAAYLSSGTWSLMGFESQTPFTNDTALAANITNEGGAEGRYRVLKNIMGL
HHEECCCCCCCEEEEECCCEEEEECCCCCCCCCCCEEEEECCCCCCCCHHHHHHHHHHHH
WLLQRVLQERQINDLPALIAATQALPACRFIINPNDDRFINPEAMCSEIQAACRETAQPI
HHHHHHHHHHCCCCHHHHHHHHHHCCCEEEEECCCCCCEECHHHHHHHHHHHHHHHCCCC
PESDAELARCIFDSLALLYADVLHELAQLRGEDFSQLHIVGGGCQNTLLNQLCADACGIR
CCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCEEEEECCCHHHHHHHHHHHHHCCCE
VIAGPVEASTLGNIGIQLMTLDELNNVDDFRQVVSTTANLTTFTPNPDSEIAHYVAQIHS
EEECCCCCCHHCCCCEEEEEHHHCCCHHHHHHHHHCCCCEEEECCCCCHHHHHHHHHHHH
TRQTKELCA
HHHHHHHCC
>Mature Secondary Structure 
TFRNCVAVDLGASSGRVMLARYERECRSLTLREIHRFKNGLHSQNGYVTWNVDSLESAI
CCCCEEEEEECCCCCCEEHHHHHHHHHHHHHHHHHHHHHCCCCCCCEEEEEHHHHHHHH
RLGLNKVCEEGIRIDSIGIDTWGVDFVLLDQQGQRVGLPVAYRDSRSNGLMAQAQQQLGK
HHHHHHHHHCCCEEEEECCCCCCCEEEEECCCCCEECCEEEECCCCCCCHHHHHHHHHHH
RDIYQRSGIQFLPFNTLYQLRALTEQQPELIPHIAHALLMPDYFSYRLTGKMNWEYTNAT
HHHHHHCCCEEECHHHHHHHHHHHHCCHHHHHHHHHHHHCCCCCCEEEEEEEEEEECCCC
TTQLVNINSDDWDESLLAWSGANKAWFGRPTHPGNVIGHWICPQGNEIPVVAVASHDTAS
EEEEEECCCCCCCCHHHEECCCCCCCCCCCCCCCCCEEEEECCCCCCCCEEEEECCCCCC
AVIASPLNGSRAAYLSSGTWSLMGFESQTPFTNDTALAANITNEGGAEGRYRVLKNIMGL
HHEECCCCCCCEEEEECCCEEEEECCCCCCCCCCCEEEEECCCCCCCCHHHHHHHHHHHH
WLLQRVLQERQINDLPALIAATQALPACRFIINPNDDRFINPEAMCSEIQAACRETAQPI
HHHHHHHHHHCCCCHHHHHHHHHHCCCEEEEECCCCCCEECHHHHHHHHHHHHHHHCCCC
PESDAELARCIFDSLALLYADVLHELAQLRGEDFSQLHIVGGGCQNTLLNQLCADACGIR
CCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCEEEEECCCHHHHHHHHHHHHHCCCE
VIAGPVEASTLGNIGIQLMTLDELNNVDDFRQVVSTTANLTTFTPNPDSEIAHYVAQIHS
EEECCCCCCHHCCCCEEEEEHHHCCCHHHHHHHHHCCCCEEEECCCCCHHHHHHHHHHHH
TRQTKELCA
HHHHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA