The gene/protein map for NC_000964 is currently unavailable.
Definition Bacillus subtilis subsp. subtilis str. 168 chromosome, complete genome.
Accession NC_000964
Length 4,215,606

Click here to switch to the map view.

The map label for this gene is abfA

Identifier: 255767661

GI number: 255767661

Start: 2938330

End: 2939832

Strand: Reverse

Name: abfA

Synonym: BSU28720

Alternate gene names: 255767661

Gene position: 2939832-2938330 (Counterclockwise)

Preceding gene: 255767662

Following gene: 255767660

Centisome position: 69.74

GC content: 45.71

Gene sequence:

>1503_bases
ATGAAAAAAGCGCGAATGATTGTAGACAAAGAATATAAAATCGGTGAAGTAGATAAACGGATTTATGGCTCGTTTATCGA
ACATATGGGTCGTGCGGTATATGAAGGCATATACGAGCCTGATCACCCTGAAGCGGATGAAGATGGATTTAGAAAAGATG
TCCAGTCGCTGATCAAAGAATTACAGGTTCCCATCATCCGCTATCCGGGCGGAAACTTTTTATCCGGATACAACTGGGAG
GACGGTGTCGGACCAGTCGAAAACCGCCCGAGACGGCTTGACTTGGCATGGCAAACGACAGAAACCAATGAAGTGGGAAC
AAATGAATTTTTATCTTGGGCAAAAAAGGTGAACACTGAGGTCAATATGGCCGTCAACCTTGGCACAAGAGGCATAGATG
CCGCCCGTAATCTCGTTGAATATTGCAACCATCCGAAAGGCTCTTACTGGAGTGATTTAAGAAGATCGCATGGCTATGAA
CAGCCGTATGGCATCAAAACATGGTGCTTAGGAAACGAAATGGATGGACCATGGCAGATCGGCCACAAAACAGCTGATGA
ATACGGACGGCTTGCCGCAGAGACAGCAAAGGTCATGAAGTGGGTTGACCCATCAATTGAACTCGTTGCCTGCGGCAGCT
CAAACAGCGGTATGCCGACCTTTATCGATTGGGAAGCGAAGGTGCTTGAGCATACGTATGAGCATGTCGACTATATCTCT
CTTCACACTTACTACGGAAACCGGGATAACAATCTGCCAAACTACTTGGCACGTTCTATGGATTTGGATCATTTTATCAA
ATCAGTCGCTGCGACCTGTGACTATGTAAAAGCAAAAACACGCAGCAAGAAAACTATCAATCTCTCTCTGGATGAATGGA
ACGTCTGGTACCACTCAAATGAGGCTGATAAAAAAGTCGAGCCGTGGATCACTGCGCGTCCGATTTTAGAGGATATTTAC
AATTTTGAAGATGCCTTATTAGTCGGCTCTCTGCTCATTACGATGCTGCAGCACGCAGACCGTGTGAAAATTGCGTGTCT
TGCACAGCTTGTTAATGTCATCGCGCCGATCATGACGGAAAAAGGCGGAGAAGCATGGAGACAGCCGATTTTCTATCCAT
ACATGCATGCTTCTGTTTACGGAAGGGGCGAGTCACTGAAACCGCTTATTTCTTCTCCTAAGTACGATTGTTCTGATTTC
ACTGATGTGCCATATGTTGATGCTGCTGTTGTGTACTCTGAAGAGGAAGAAACACTCACTATTTTTGCGGTAAACAAGGC
TGAGGATCAGATGGAGACGGAGATTTCGCTCAGAGGCTTTGAATCCTACCAAATCGCAGAGCACATCGTACTTGAGCATC
AGGATATCAAAGCAACAAACCAGCATAACAGAAAAAATGTCGTTCCGCATTCCAACGGATCATCGTCTGTCAGCGAAAAC
GGCTTAACTGCTCATTTCACGCCGCTTTCCTGGAATGTGATCCGCCTGAAAAAACAGTCATAA

Upstream 100 bases:

>100_bases
GATTTTGCCGGTGATTATCATTTTCTTGTTTTTCCAAAAGTACTTTATCTCCGGCCTGACGGTAGGGGGAGTCAAAGGTT
AATGAAGGAGGAAACGTGTG

Downstream 100 bases:

>100_bases
GAATAGCAAAGCCGGAGATTTCTCTCCGGCTTGTCTTTCAACTGCCACGAGCCGGCCCATTCCAGCCGGCTTTTTGTATA
GGAAAAAATGACCGCTTTTC

Product: alpha-L-arabinofuranosidase

Products: NA

Alternate protein names: Arabinosidase 1

Number of amino acids: Translated: 500; Mature: 500

Protein sequence:

>500_residues
MKKARMIVDKEYKIGEVDKRIYGSFIEHMGRAVYEGIYEPDHPEADEDGFRKDVQSLIKELQVPIIRYPGGNFLSGYNWE
DGVGPVENRPRRLDLAWQTTETNEVGTNEFLSWAKKVNTEVNMAVNLGTRGIDAARNLVEYCNHPKGSYWSDLRRSHGYE
QPYGIKTWCLGNEMDGPWQIGHKTADEYGRLAAETAKVMKWVDPSIELVACGSSNSGMPTFIDWEAKVLEHTYEHVDYIS
LHTYYGNRDNNLPNYLARSMDLDHFIKSVAATCDYVKAKTRSKKTINLSLDEWNVWYHSNEADKKVEPWITARPILEDIY
NFEDALLVGSLLITMLQHADRVKIACLAQLVNVIAPIMTEKGGEAWRQPIFYPYMHASVYGRGESLKPLISSPKYDCSDF
TDVPYVDAAVVYSEEEETLTIFAVNKAEDQMETEISLRGFESYQIAEHIVLEHQDIKATNQHNRKNVVPHSNGSSSVSEN
GLTAHFTPLSWNVIRLKKQS

Sequences:

>Translated_500_residues
MKKARMIVDKEYKIGEVDKRIYGSFIEHMGRAVYEGIYEPDHPEADEDGFRKDVQSLIKELQVPIIRYPGGNFLSGYNWE
DGVGPVENRPRRLDLAWQTTETNEVGTNEFLSWAKKVNTEVNMAVNLGTRGIDAARNLVEYCNHPKGSYWSDLRRSHGYE
QPYGIKTWCLGNEMDGPWQIGHKTADEYGRLAAETAKVMKWVDPSIELVACGSSNSGMPTFIDWEAKVLEHTYEHVDYIS
LHTYYGNRDNNLPNYLARSMDLDHFIKSVAATCDYVKAKTRSKKTINLSLDEWNVWYHSNEADKKVEPWITARPILEDIY
NFEDALLVGSLLITMLQHADRVKIACLAQLVNVIAPIMTEKGGEAWRQPIFYPYMHASVYGRGESLKPLISSPKYDCSDF
TDVPYVDAAVVYSEEEETLTIFAVNKAEDQMETEISLRGFESYQIAEHIVLEHQDIKATNQHNRKNVVPHSNGSSSVSEN
GLTAHFTPLSWNVIRLKKQS
>Mature_500_residues
MKKARMIVDKEYKIGEVDKRIYGSFIEHMGRAVYEGIYEPDHPEADEDGFRKDVQSLIKELQVPIIRYPGGNFLSGYNWE
DGVGPVENRPRRLDLAWQTTETNEVGTNEFLSWAKKVNTEVNMAVNLGTRGIDAARNLVEYCNHPKGSYWSDLRRSHGYE
QPYGIKTWCLGNEMDGPWQIGHKTADEYGRLAAETAKVMKWVDPSIELVACGSSNSGMPTFIDWEAKVLEHTYEHVDYIS
LHTYYGNRDNNLPNYLARSMDLDHFIKSVAATCDYVKAKTRSKKTINLSLDEWNVWYHSNEADKKVEPWITARPILEDIY
NFEDALLVGSLLITMLQHADRVKIACLAQLVNVIAPIMTEKGGEAWRQPIFYPYMHASVYGRGESLKPLISSPKYDCSDF
TDVPYVDAAVVYSEEEETLTIFAVNKAEDQMETEISLRGFESYQIAEHIVLEHQDIKATNQHNRKNVVPHSNGSSSVSEN
GLTAHFTPLSWNVIRLKKQS

Specific function: Unknown

COG id: COG3534

COG function: function code G; Alpha-L-arabinofuranosidase

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Belongs to the glycosyl hydrolase 51 family

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): ABFA_BACSU (P94531)

Other databases:

- EMBL:   X89810
- EMBL:   Z75208
- EMBL:   AL009126
- PIR:   C69580
- RefSeq:   NP_390750.2
- ProteinModelPortal:   P94531
- SMR:   P94531
- EnsemblBacteria:   EBBACT00000002808
- GeneID:   937509
- GenomeReviews:   AL009126_GR
- KEGG:   bsu:BSU28720
- NMPDR:   fig|224308.1.peg.2875
- GenoList:   BSU28720
- GeneTree:   EBGT00050000002580
- HOGENOM:   HBG654651
- ProtClustDB:   CLSK2539632
- BioCyc:   BSUB:BSU28720-MONOMER
- BRENDA:   3.2.1.55
- InterPro:   IPR010720
- InterPro:   IPR017853
- InterPro:   IPR013781
- Gene3D:   G3DSA:3.20.20.80
- SMART:   SM00813

Pfam domain/function: PF06964 Alpha-L-AF_C; SSF51445 Glyco_hydro_cat

EC number: =3.2.1.55

Molecular weight: Translated: 57035; Mature: 57035

Theoretical pI: Translated: 5.48; Mature: 5.48

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.2 %Cys     (Translated Protein)
2.4 %Met     (Translated Protein)
3.6 %Cys+Met (Translated Protein)
1.2 %Cys     (Mature Protein)
2.4 %Met     (Mature Protein)
3.6 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKKARMIVDKEYKIGEVDKRIYGSFIEHMGRAVYEGIYEPDHPEADEDGFRKDVQSLIKE
CCCCCEEECCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCHHHHHHHHHHHHH
LQVPIIRYPGGNFLSGYNWEDGVGPVENRPRRLDLAWQTTETNEVGTNEFLSWAKKVNTE
HCCCEEECCCCCCCCCCCCCCCCCCCCCCCCEEEEEEECCCCCCCCHHHHHHHHHHCCCC
VNMAVNLGTRGIDAARNLVEYCNHPKGSYWSDLRRSHGYEQPYGIKTWCLGNEMDGPWQI
EEEEEECCCCCHHHHHHHHHHHCCCCCCHHHHHHHHCCCCCCCCCEEEEECCCCCCCCCC
GHKTADEYGRLAAETAKVMKWVDPSIELVACGSSNSGMPTFIDWEAKVLEHTYEHVDYIS
CCCCHHHHHHHHHHHHHHHHHCCCCEEEEEECCCCCCCCEEECHHHHHHHHHHHHCCEEE
LHTYYGNRDNNLPNYLARSMDLDHFIKSVAATCDYVKAKTRSKKTINLSLDEWNVWYHSN
EEEEECCCCCCCHHHHHHHCCHHHHHHHHHHHHHHHHHHCCCCEEEEEEEECEEEEEECC
EADKKVEPWITARPILEDIYNFEDALLVGSLLITMLQHADRVKIACLAQLVNVIAPIMTE
CCCCCCCCCCHHHHHHHHHHCHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHC
KGGEAWRQPIFYPYMHASVYGRGESLKPLISSPKYDCSDFTDVPYVDAAVVYSEEEETLT
CCCHHHHCCCCCHHHHHEEECCCCCCCHHHCCCCCCCCCCCCCCCCCEEEEEECCCCEEE
IFAVNKAEDQMETEISLRGFESYQIAEHIVLEHQDIKATNQHNRKNVVPHSNGSSSVSEN
EEEECCCCHHHHHHHHCCCCCHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCC
GLTAHFTPLSWNVIRLKKQS
CCEEEECCCCEEEEEEEECC
>Mature Secondary Structure
MKKARMIVDKEYKIGEVDKRIYGSFIEHMGRAVYEGIYEPDHPEADEDGFRKDVQSLIKE
CCCCCEEECCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCHHHHHHHHHHHHH
LQVPIIRYPGGNFLSGYNWEDGVGPVENRPRRLDLAWQTTETNEVGTNEFLSWAKKVNTE
HCCCEEECCCCCCCCCCCCCCCCCCCCCCCCEEEEEEECCCCCCCCHHHHHHHHHHCCCC
VNMAVNLGTRGIDAARNLVEYCNHPKGSYWSDLRRSHGYEQPYGIKTWCLGNEMDGPWQI
EEEEEECCCCCHHHHHHHHHHHCCCCCCHHHHHHHHCCCCCCCCCEEEEECCCCCCCCCC
GHKTADEYGRLAAETAKVMKWVDPSIELVACGSSNSGMPTFIDWEAKVLEHTYEHVDYIS
CCCCHHHHHHHHHHHHHHHHHCCCCEEEEEECCCCCCCCEEECHHHHHHHHHHHHCCEEE
LHTYYGNRDNNLPNYLARSMDLDHFIKSVAATCDYVKAKTRSKKTINLSLDEWNVWYHSN
EEEEECCCCCCCHHHHHHHCCHHHHHHHHHHHHHHHHHHCCCCEEEEEEEECEEEEEECC
EADKKVEPWITARPILEDIYNFEDALLVGSLLITMLQHADRVKIACLAQLVNVIAPIMTE
CCCCCCCCCCHHHHHHHHHHCHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHC
KGGEAWRQPIFYPYMHASVYGRGESLKPLISSPKYDCSDFTDVPYVDAAVVYSEEEETLT
CCCHHHHCCCCCHHHHHEEECCCCCCCHHHCCCCCCCCCCCCCCCCCEEEEEECCCCEEE
IFAVNKAEDQMETEISLRGFESYQIAEHIVLEHQDIKATNQHNRKNVVPHSNGSSSVSEN
EEEECCCCHHHHHHHHCCCCCHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCC
GLTAHFTPLSWNVIRLKKQS
CCEEEECCCCEEEEEEEECC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 9084180; 8969504; 9384377; 10417639