Definition Bacillus subtilis subsp. subtilis str. 168 chromosome, complete genome.
Accession NC_000964
Length 4,215,606

Click here to switch to the map view.

The map label for this gene is araP

Identifier: 16079926

GI number: 16079926

Start: 2940697

End: 2941638

Strand: Reverse

Name: araP

Synonym: BSU28740

Alternate gene names: 16079926

Gene position: 2941638-2940697 (Counterclockwise)

Preceding gene: 255767663

Following gene: 255767662

Centisome position: 69.78

GC content: 44.8

Gene sequence:

>942_bases
ATGAAACCTGTGAAAACGGGAACGGTTCATCCCGTTCCTTCAGCTGCGAAACAATCAGGCTGGCGAGATCTGTTTTATTC
AAAAAAAGCGGCGCCCTATCTGTTTACAGCGCCATTCGTTTTATCCTTTCTCGTATTTTTTCTATACCCCATCATTAGTG
TCTTCATCATGAGCTTCCAAAGAATTTTGCCGGGAGAGGTGTCCTTTGTCGGATTGTCTAATTATACAGCGCTAAACAAC
CCGACGTTCTATACCGCCCTTTGGAATACGCTGGAATACACCTTTTGGACGCTGATCGTGCTGATTCCTGTTCCATTGCT
TCTGGCCATATTCCTGAATTCAAAGCTGGTCAAATTTAGAAATATATTTAAATCAGCATTATTTATCCCGGCATTGACCT
CAACCATTGTCGCGGGGATCATTTTTCGGCTGATCTTCGGAGAAATGGAAACGTCTCTGGCCAATTCCATCCTACTTAAA
CTCGGCTTTTCACCTCAGAACTGGATGAACAATGAACATACCGGCATGTTTTTGATGGTGCTGCTTGCTTCATGGAGATG
GATGGGAATCAACATCCTTTACTTTTTAGCAGGTTTGCAAAATGTGCCGAAAGAGCTGTACGAAGCCGCTGATATAGACG
GCGCGAATACAATGAAAAAATTTCTGCACATCACGCTGCCGTTTCTCAAGCCTGTAACCGTATATGTGCTGACCATCAGC
ATCATCGGCGGCTTCAGGATGTTTGAGGAAAGCTACGTCCTTTGGCAGAATAATTCCCCGGGTAATATTGGTCTGACGCT
TGTCGGATATTTGTATCAGCAGGGACTTGCCTACAATGAAATGGGATACGGAGCGGCCATCGGCATTGTGCTTTTGATTG
TGATCCTTGTTGTCAGCCTGATTTCATTAAAGCTGTCAGGCTCGTTTAAGGGGGAGGGATAA

Upstream 100 bases:

>100_bases
AATCTCAGCAAAAAACGCCTAAACAAGCCTTGGACAGAGCGGCAGGTGAACTGAAACAGAAATAGAATCCCATTCAAAAA
GTGAAAGCGGGGAGGTTCTC

Downstream 100 bases:

>100_bases
ATGTTGCGGCACAGTCCTCAGTTTAGCGTTTATAGAATTGCGCTGACCCTGTTTTTTATGATGCTGAGCCTATTGTATCT
TTTTCCGATTTTCTGTTTGC

Product: arabinose/arabinan permease

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 313; Mature: 313

Protein sequence:

>313_residues
MKPVKTGTVHPVPSAAKQSGWRDLFYSKKAAPYLFTAPFVLSFLVFFLYPIISVFIMSFQRILPGEVSFVGLSNYTALNN
PTFYTALWNTLEYTFWTLIVLIPVPLLLAIFLNSKLVKFRNIFKSALFIPALTSTIVAGIIFRLIFGEMETSLANSILLK
LGFSPQNWMNNEHTGMFLMVLLASWRWMGINILYFLAGLQNVPKELYEAADIDGANTMKKFLHITLPFLKPVTVYVLTIS
IIGGFRMFEESYVLWQNNSPGNIGLTLVGYLYQQGLAYNEMGYGAAIGIVLLIVILVVSLISLKLSGSFKGEG

Sequences:

>Translated_313_residues
MKPVKTGTVHPVPSAAKQSGWRDLFYSKKAAPYLFTAPFVLSFLVFFLYPIISVFIMSFQRILPGEVSFVGLSNYTALNN
PTFYTALWNTLEYTFWTLIVLIPVPLLLAIFLNSKLVKFRNIFKSALFIPALTSTIVAGIIFRLIFGEMETSLANSILLK
LGFSPQNWMNNEHTGMFLMVLLASWRWMGINILYFLAGLQNVPKELYEAADIDGANTMKKFLHITLPFLKPVTVYVLTIS
IIGGFRMFEESYVLWQNNSPGNIGLTLVGYLYQQGLAYNEMGYGAAIGIVLLIVILVVSLISLKLSGSFKGEG
>Mature_313_residues
MKPVKTGTVHPVPSAAKQSGWRDLFYSKKAAPYLFTAPFVLSFLVFFLYPIISVFIMSFQRILPGEVSFVGLSNYTALNN
PTFYTALWNTLEYTFWTLIVLIPVPLLLAIFLNSKLVKFRNIFKSALFIPALTSTIVAGIIFRLIFGEMETSLANSILLK
LGFSPQNWMNNEHTGMFLMVLLASWRWMGINILYFLAGLQNVPKELYEAADIDGANTMKKFLHITLPFLKPVTVYVLTIS
IIGGFRMFEESYVLWQNNSPGNIGLTLVGYLYQQGLAYNEMGYGAAIGIVLLIVILVVSLISLKLSGSFKGEG

Specific function: Part of the binding-protein-dependent transport system for L-arabinose. Probably responsible for the translocation of the substrate across the membrane

COG id: COG1175

COG function: function code G; ABC-type sugar transport systems, permease components

Gene ontology:

Cell location: Cell membrane; Multi-pass membrane protein (Probable)

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 ABC transmembrane type-1 domain

Homologues:

Organism=Escherichia coli, GI1787570, Length=264, Percent_Identity=33.7121212121212, Blast_Score=117, Evalue=1e-27,
Organism=Escherichia coli, GI1789861, Length=286, Percent_Identity=26.5734265734266, Blast_Score=106, Evalue=2e-24,
Organism=Escherichia coli, GI1790465, Length=268, Percent_Identity=22.7611940298507, Blast_Score=70, Evalue=2e-13,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): ARAP_BACSU (P94529)

Other databases:

- EMBL:   X89810
- EMBL:   Z75208
- EMBL:   AL009126
- PIR:   B69588
- RefSeq:   NP_390752.1
- ProteinModelPortal:   P94529
- EnsemblBacteria:   EBBACT00000000392
- GeneID:   937432
- GenomeReviews:   AL009126_GR
- KEGG:   bsu:BSU28740
- NMPDR:   fig|224308.1.peg.2877
- GenoList:   BSU28740
- GeneTree:   EBGT00050000000647
- HOGENOM:   HBG739365
- OMA:   LASWRWM
- PhylomeDB:   P94529
- ProtClustDB:   CLSK872865
- BioCyc:   BSUB:BSU28740-MONOMER
- InterPro:   IPR000515

Pfam domain/function: PF00528 BPD_transp_1

EC number: NA

Molecular weight: Translated: 35035; Mature: 35035

Theoretical pI: Translated: 9.80; Mature: 9.80

Prosite motif: PS50928 ABC_TM1

Important sites: NA

Signals:

None

Transmembrane regions:

HASH(0x1188f064)-; HASH(0x11613778)-; HASH(0x11302880)-; HASH(0xea35e20)-; HASH(0xd6d18d8)-; HASH(0x1169b3bc)-;

Cys/Met content:

0.0 %Cys     (Translated Protein)
3.2 %Met     (Translated Protein)
3.2 %Cys+Met (Translated Protein)
0.0 %Cys     (Mature Protein)
3.2 %Met     (Mature Protein)
3.2 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKPVKTGTVHPVPSAAKQSGWRDLFYSKKAAPYLFTAPFVLSFLVFFLYPIISVFIMSFQ
CCCCCCCCCCCCCCHHHHCCHHHHHHCCCCCCEEEEHHHHHHHHHHHHHHHHHHHHHHHH
RILPGEVSFVGLSNYTALNNPTFYTALWNTLEYTFWTLIVLIPVPLLLAIFLNSKLVKFR
HHCCCCEEEEECCCCEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHH
NIFKSALFIPALTSTIVAGIIFRLIFGEMETSLANSILLKLGFSPQNWMNNEHTGMFLMV
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHCCCCCCHHHHHHH
LLASWRWMGINILYFLAGLQNVPKELYEAADIDGANTMKKFLHITLPFLKPVTVYVLTIS
HHHHCHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHH
IIGGFRMFEESYVLWQNNSPGNIGLTLVGYLYQQGLAYNEMGYGAAIGIVLLIVILVVSL
HHHHHHHHHCCEEEEECCCCCCHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHH
ISLKLSGSFKGEG
HHHHHCCCCCCCH
>Mature Secondary Structure
MKPVKTGTVHPVPSAAKQSGWRDLFYSKKAAPYLFTAPFVLSFLVFFLYPIISVFIMSFQ
CCCCCCCCCCCCCCHHHHCCHHHHHHCCCCCCEEEEHHHHHHHHHHHHHHHHHHHHHHHH
RILPGEVSFVGLSNYTALNNPTFYTALWNTLEYTFWTLIVLIPVPLLLAIFLNSKLVKFR
HHCCCCEEEEECCCCEECCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHH
NIFKSALFIPALTSTIVAGIIFRLIFGEMETSLANSILLKLGFSPQNWMNNEHTGMFLMV
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHCCCCCCHHHHHHH
LLASWRWMGINILYFLAGLQNVPKELYEAADIDGANTMKKFLHITLPFLKPVTVYVLTIS
HHHHCHHHHHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHH
IIGGFRMFEESYVLWQNNSPGNIGLTLVGYLYQQGLAYNEMGYGAAIGIVLLIVILVVSL
HHHHHHHHHCCEEEEECCCCCCHHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHHHH
ISLKLSGSFKGEG
HHHHHCCCCCCCH

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 7.0

TargetDB status: NA

Availability: NA

References: 9084180; 8969504; 9384377; 10417639