Definition Bacillus subtilis subsp. subtilis str. 168 chromosome, complete genome.
Accession NC_000964
Length 4,215,606

Click here to switch to the map view.

The map label for this gene is araB

Identifier: 16079931

GI number: 16079931

Start: 2945689

End: 2947371

Strand: Reverse

Name: araB

Synonym: BSU28790

Alternate gene names: 16079931

Gene position: 2947371-2945689 (Counterclockwise)

Preceding gene: 255767664

Following gene: 16079930

Centisome position: 69.92

GC content: 47.77

Gene sequence:

>1683_bases
ATGGCTTACACAATAGGGGTTGATTTTGGAACTTTATCAGGAAGAGCAGTGCTCGTTCATGTCCAAACAGGGGAGGAACT
TGCGGCTGCTGTAAAAGAATACAGGCATGCTGTCATTGATACCGTCCTTCCAAAAACGGGTCAAAAGCTGCCGCGTGACT
GGGCGCTGCAGCACCCTGCTGATTACCTCGAAGTCTTGGAAACAACCATTCCGTCTTTACTCGAACAGACGGGCGTTGAC
CCGAAAGACATTATCGGGATTGGAATTGATTTCACGGCATGTACGATCCTTCCTATTGACAGCAGCGGGCAGCCGTTATG
CATGCTGCCTGAATATGAAGAGGAGCCGCACAGCTATGTGAAGCTCTGGAAGCATCATGCGGCCCAAAAACATGCTGATC
GGCTCAATCAAATCGCGGAAGAAGAAGGAGAGGCTTTTTTACAGCGGTACGGAGGAAAAATTTCATCAGAATGGATGATT
CCAAAGGTCATGCAAATTGCCGAGGAAGCGCCTCACATTTATGAAGCGGCTGACCGGATCATCGAGGCTGCGGACTGGAT
CGTGTACCAGCTGTGCGGCTCGCTCAAGCGAAGCAATTGTACCGCAGGGTATAAAGCGATGTGGAGTGAAAAAGCGGGGT
ATCCGTCAGATGATTTCTTTGAGAAATTAAATCCTTCAATGAAAACGATTACAAAGGACAAATTGTCAGGTTCTATTCAT
TCAGTAGGAGAAAAAGCCGGCAGTCTGACTGAAAAAATGGCAAAGCTGACAGGGCTTCTCCCGGGAACGGCTGTTGCGGT
TGCCAATGTGGACGCTCATGTTTCGGTACCGGCGGTCGGCATTACAGAGCCAGGGAAAATGCTGATGATTATGGGAACCT
CGACGTGCCATGTTCTACTTGGTGAAGAGGTGCATATCGTTCCAGGAATGTGCGGCGTTGTGGACAACGGAATTCTCCCG
GGCTATGCGGGATATGAAGCCGGGCAGTCCTGTGTCGGCGATCATTTTGACTGGTTTGTGAAAACATGTGTCCCGCCAGC
TTATCAAGAGGAAGCAAAGGAAAAAAACATTGGCGTTCATGAGCTGCTGAGTGAGAAAGCAAACCATCAAGCGCCTGGTG
AAAGCGGCTTGCTTGCTTTAGATTGGTGGAATGGAAACCGTTCAACTCTTGTTGATGCAGATTTAACAGGGATGCTGCTT
GGCATGACACTGCTGACGAAGCCTGAAGAGATTTATAGAGCGTTAGTTGAAGCGACAGCTTACGGAACCCGGATGATTAT
CGAAACATTCAAAGAAAGCGGTGTTCCGATTGAGGAACTGTTCGCAGCCGGCGGAATAGCTGAGAAAAACCCGTTTGTCA
TGCAGATTTATGCGGATGTGACAAACATGGACATTAAAATCTCTGGTTCACCGCAAGCCCCAGCCTTAGGATCTGCCATT
TTCGGCGCGCTTGCAGCAGGCAAAGAAAAAGGCGGCTACGATGATATCAAAAAGGCAGCGGCGAACATGGGAAAACTGAA
AGATATAACTTATACGCCAAATGCCGAAAACGCCGCGGTTTATGAAAAATTGTACGCTGAATATAAAGAGCTGGTTCATT
ATTTCGGAAAAGAAAACCATGTCATGAAGCGTCTGAAAACGATCAAAAATCTTCAATTTTCATCTGCCGCCAAAAAGAAT
TGA

Upstream 100 bases:

>100_bases
AGTGTTCTCATTTCCCGTGATACGACAATTCATAAACTGAAACACGAGTTAAAATGGAACGAGGCGCTTTACCGGCTTCA
AAAGTAGAGGGGGATGTCAC

Downstream 100 bases:

>100_bases
TAAAGGGTGATGGAGCATGCTTGAAACATTAAAAAAAGAAGTGCTGGCTGCCAACCTGAAGCTTCAAGAGCATCAGCTGG
TAACCTTTACGTGGGGAAAT

Product: ribulokinase

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 560; Mature: 559

Protein sequence:

>560_residues
MAYTIGVDFGTLSGRAVLVHVQTGEELAAAVKEYRHAVIDTVLPKTGQKLPRDWALQHPADYLEVLETTIPSLLEQTGVD
PKDIIGIGIDFTACTILPIDSSGQPLCMLPEYEEEPHSYVKLWKHHAAQKHADRLNQIAEEEGEAFLQRYGGKISSEWMI
PKVMQIAEEAPHIYEAADRIIEAADWIVYQLCGSLKRSNCTAGYKAMWSEKAGYPSDDFFEKLNPSMKTITKDKLSGSIH
SVGEKAGSLTEKMAKLTGLLPGTAVAVANVDAHVSVPAVGITEPGKMLMIMGTSTCHVLLGEEVHIVPGMCGVVDNGILP
GYAGYEAGQSCVGDHFDWFVKTCVPPAYQEEAKEKNIGVHELLSEKANHQAPGESGLLALDWWNGNRSTLVDADLTGMLL
GMTLLTKPEEIYRALVEATAYGTRMIIETFKESGVPIEELFAAGGIAEKNPFVMQIYADVTNMDIKISGSPQAPALGSAI
FGALAAGKEKGGYDDIKKAAANMGKLKDITYTPNAENAAVYEKLYAEYKELVHYFGKENHVMKRLKTIKNLQFSSAAKKN

Sequences:

>Translated_560_residues
MAYTIGVDFGTLSGRAVLVHVQTGEELAAAVKEYRHAVIDTVLPKTGQKLPRDWALQHPADYLEVLETTIPSLLEQTGVD
PKDIIGIGIDFTACTILPIDSSGQPLCMLPEYEEEPHSYVKLWKHHAAQKHADRLNQIAEEEGEAFLQRYGGKISSEWMI
PKVMQIAEEAPHIYEAADRIIEAADWIVYQLCGSLKRSNCTAGYKAMWSEKAGYPSDDFFEKLNPSMKTITKDKLSGSIH
SVGEKAGSLTEKMAKLTGLLPGTAVAVANVDAHVSVPAVGITEPGKMLMIMGTSTCHVLLGEEVHIVPGMCGVVDNGILP
GYAGYEAGQSCVGDHFDWFVKTCVPPAYQEEAKEKNIGVHELLSEKANHQAPGESGLLALDWWNGNRSTLVDADLTGMLL
GMTLLTKPEEIYRALVEATAYGTRMIIETFKESGVPIEELFAAGGIAEKNPFVMQIYADVTNMDIKISGSPQAPALGSAI
FGALAAGKEKGGYDDIKKAAANMGKLKDITYTPNAENAAVYEKLYAEYKELVHYFGKENHVMKRLKTIKNLQFSSAAKKN
>Mature_559_residues
AYTIGVDFGTLSGRAVLVHVQTGEELAAAVKEYRHAVIDTVLPKTGQKLPRDWALQHPADYLEVLETTIPSLLEQTGVDP
KDIIGIGIDFTACTILPIDSSGQPLCMLPEYEEEPHSYVKLWKHHAAQKHADRLNQIAEEEGEAFLQRYGGKISSEWMIP
KVMQIAEEAPHIYEAADRIIEAADWIVYQLCGSLKRSNCTAGYKAMWSEKAGYPSDDFFEKLNPSMKTITKDKLSGSIHS
VGEKAGSLTEKMAKLTGLLPGTAVAVANVDAHVSVPAVGITEPGKMLMIMGTSTCHVLLGEEVHIVPGMCGVVDNGILPG
YAGYEAGQSCVGDHFDWFVKTCVPPAYQEEAKEKNIGVHELLSEKANHQAPGESGLLALDWWNGNRSTLVDADLTGMLLG
MTLLTKPEEIYRALVEATAYGTRMIIETFKESGVPIEELFAAGGIAEKNPFVMQIYADVTNMDIKISGSPQAPALGSAIF
GALAAGKEKGGYDDIKKAAANMGKLKDITYTPNAENAAVYEKLYAEYKELVHYFGKENHVMKRLKTIKNLQFSSAAKKN

Specific function: Unknown

COG id: COG1069

COG function: function code C; Ribulose kinase

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the ribulokinase family

Homologues:

Organism=Homo sapiens, GI164663828, Length=560, Percent_Identity=29.1071428571429, Blast_Score=184, Evalue=2e-46,
Organism=Homo sapiens, GI164663830, Length=584, Percent_Identity=27.9109589041096, Blast_Score=170, Evalue=3e-42,
Organism=Escherichia coli, GI1786249, Length=553, Percent_Identity=32.1880650994575, Blast_Score=278, Evalue=8e-76,
Organism=Escherichia coli, GI1787789, Length=537, Percent_Identity=23.0912476722533, Blast_Score=91, Evalue=2e-19,
Organism=Saccharomyces cerevisiae, GI6320314, Length=533, Percent_Identity=25.515947467167, Blast_Score=138, Evalue=2e-33,
Organism=Drosophila melanogaster, GI24657106, Length=571, Percent_Identity=28.3712784588441, Blast_Score=166, Evalue=5e-41,
Organism=Drosophila melanogaster, GI24657102, Length=571, Percent_Identity=28.3712784588441, Blast_Score=166, Evalue=5e-41,
Organism=Drosophila melanogaster, GI21356323, Length=445, Percent_Identity=28.0898876404494, Blast_Score=137, Evalue=2e-32,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): ARAB_BACSU (P94524)

Other databases:

- EMBL:   X89408
- EMBL:   Z75208
- EMBL:   AL009126
- PIR:   D69587
- RefSeq:   NP_390757.1
- ProteinModelPortal:   P94524
- SMR:   P94524
- EnsemblBacteria:   EBBACT00000002557
- GeneID:   936019
- GenomeReviews:   AL009126_GR
- KEGG:   bsu:BSU28790
- NMPDR:   fig|224308.1.peg.2882
- GenoList:   BSU28790
- GeneTree:   EBGT00070000032096
- HOGENOM:   HBG312681
- OMA:   YEAGQSC
- PhylomeDB:   P94524
- ProtClustDB:   PRK04123
- BioCyc:   BSUB:BSU28790-MONOMER
- BRENDA:   2.7.1.16
- HAMAP:   MF_00520
- InterPro:   IPR000577
- InterPro:   IPR018485
- InterPro:   IPR018483
- InterPro:   IPR018484
- InterPro:   IPR005929
- PANTHER:   PTHR10196
- TIGRFAMs:   TIGR01234

Pfam domain/function: PF02782 FGGY_C; PF00370 FGGY_N

EC number: =2.7.1.16

Molecular weight: Translated: 61010; Mature: 60879

Theoretical pI: Translated: 5.28; Mature: 5.28

Prosite motif: PS00445 FGGY_KINASES_2

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.4 %Cys     (Translated Protein)
3.2 %Met     (Translated Protein)
4.6 %Cys+Met (Translated Protein)
1.4 %Cys     (Mature Protein)
3.0 %Met     (Mature Protein)
4.5 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MAYTIGVDFGTLSGRAVLVHVQTGEELAAAVKEYRHAVIDTVLPKTGQKLPRDWALQHPA
CEEEEEECCCCCCCCEEEEEEECCHHHHHHHHHHHHHHHHHHCCCCCCCCCCHHHHCCCH
DYLEVLETTIPSLLEQTGVDPKDIIGIGIDFTACTILPIDSSGQPLCMLPEYEEEPHSYV
HHHHHHHHHHHHHHHHHCCCHHHEEEECCCEEEEEEEEECCCCCCEEECCCCCCCHHHHH
KLWKHHAAQKHADRLNQIAEEEGEAFLQRYGGKISSEWMIPKVMQIAEEAPHIYEAADRI
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCHHHHHHHHHCCHHHHHHHHH
IEAADWIVYQLCGSLKRSNCTAGYKAMWSEKAGYPSDDFFEKLNPSMKTITKDKLSGSIH
HHHHHHHHHHHHHHHHCCCCCHHHHHHHHCCCCCCCHHHHHHCCCHHHHHHHHHHCCHHH
SVGEKAGSLTEKMAKLTGLLPGTAVAVANVDAHVSVPAVGITEPGKMLMIMGTSTCHVLL
HHHHHHHHHHHHHHHHHCCCCCCEEEEECCCCEEECCEECCCCCCCEEEEEECCEEEEEE
GEEVHIVPGMCGVVDNGILPGYAGYEAGQSCVGDHFDWFVKTCVPPAYQEEAKEKNIGVH
CCCEEECCCHHHHHCCCCCCCCCCHHHCHHHHCHHHHHHHHHHCCCHHHHHHHHCCCCHH
ELLSEKANHQAPGESGLLALDWWNGNRSTLVDADLTGMLLGMTLLTKPEEIYRALVEATA
HHHHHHHCCCCCCCCCEEEEEEECCCCCEEECCHHHHHHHHHHHHCCHHHHHHHHHHHHH
YGTRMIIETFKESGVPIEELFAAGGIAEKNPFVMQIYADVTNMDIKISGSPQAPALGSAI
HHHHHHHHHHHHCCCCHHHHHHCCCCCCCCCEEEEEEECCCCCEEEECCCCCCCHHHHHH
FGALAAGKEKGGYDDIKKAAANMGKLKDITYTPNAENAAVYEKLYAEYKELVHYFGKENH
HHHHHHCCCCCCHHHHHHHHHCCCCCCCEEECCCCCCHHHHHHHHHHHHHHHHHHCCCHH
VMKRLKTIKNLQFSSAAKKN
HHHHHHHHHCCCCCHHCCCC
>Mature Secondary Structure 
AYTIGVDFGTLSGRAVLVHVQTGEELAAAVKEYRHAVIDTVLPKTGQKLPRDWALQHPA
EEEEEECCCCCCCCEEEEEEECCHHHHHHHHHHHHHHHHHHCCCCCCCCCCHHHHCCCH
DYLEVLETTIPSLLEQTGVDPKDIIGIGIDFTACTILPIDSSGQPLCMLPEYEEEPHSYV
HHHHHHHHHHHHHHHHHCCCHHHEEEECCCEEEEEEEEECCCCCCEEECCCCCCCHHHHH
KLWKHHAAQKHADRLNQIAEEEGEAFLQRYGGKISSEWMIPKVMQIAEEAPHIYEAADRI
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCHHHHHHHHHCCHHHHHHHHH
IEAADWIVYQLCGSLKRSNCTAGYKAMWSEKAGYPSDDFFEKLNPSMKTITKDKLSGSIH
HHHHHHHHHHHHHHHHCCCCCHHHHHHHHCCCCCCCHHHHHHCCCHHHHHHHHHHCCHHH
SVGEKAGSLTEKMAKLTGLLPGTAVAVANVDAHVSVPAVGITEPGKMLMIMGTSTCHVLL
HHHHHHHHHHHHHHHHHCCCCCCEEEEECCCCEEECCEECCCCCCCEEEEEECCEEEEEE
GEEVHIVPGMCGVVDNGILPGYAGYEAGQSCVGDHFDWFVKTCVPPAYQEEAKEKNIGVH
CCCEEECCCHHHHHCCCCCCCCCCHHHCHHHHCHHHHHHHHHHCCCHHHHHHHHCCCCHH
ELLSEKANHQAPGESGLLALDWWNGNRSTLVDADLTGMLLGMTLLTKPEEIYRALVEATA
HHHHHHHCCCCCCCCCEEEEEEECCCCCEEECCHHHHHHHHHHHHCCHHHHHHHHHHHHH
YGTRMIIETFKESGVPIEELFAAGGIAEKNPFVMQIYADVTNMDIKISGSPQAPALGSAI
HHHHHHHHHHHHCCCCHHHHHHCCCCCCCCCEEEEEEECCCCCEEEECCCCCCCHHHHHH
FGALAAGKEKGGYDDIKKAAANMGKLKDITYTPNAENAAVYEKLYAEYKELVHYFGKENH
HHHHHHCCCCCCHHHHHHHHHCCCCCCCEEECCCCCCHHHHHHHHHHHHHHHHHHCCCHH
VMKRLKTIKNLQFSSAAKKN
HHHHHHHHHCCCCCHHCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 9084180; 8969504; 9384377; 10417639