| Definition | Bacillus anthracis str. Sterne chromosome, complete genome. |
|---|---|
| Accession | NC_005945 |
| Length | 5,228,663 |
Click here to switch to the map view.
The map label for this gene is dppE [H]
Identifier: 49184127
GI number: 49184127
Start: 1161085
End: 1162689
Strand: Direct
Name: dppE [H]
Synonym: BAS1107
Alternate gene names: 49184127
Gene position: 1161085-1162689 (Clockwise)
Preceding gene: 49184125
Following gene: 49184129
Centisome position: 22.21
GC content: 34.52
Gene sequence:
>1605_bases ATGAGCATGATGTTAGGGGCATGTAGCTACCAAAAAGATGAGCCGCAAGCGAACGCAAAAGGGGATAGCGGGAAAAGCGG TGCGAAGCAAGTTATTAATCTAACGGAAGTGTCTGAAATTCCGACAATGGATACGACACTTGCCTCGGATGCTGCTTCTT CAAAAGTTATGAATAATACAATGGAAGGGCTATATCGACTTGGGAAAGGCGATAAGTTAGTTCCAGGTGTAGCGAAATCT CATACGAAATCTGAAGATGGTAAAAAATATACATTTAAATTGCGTGAAGACGCTAAATGGTCGAATGGTGATCCTGTAAC AGCAAAAGATTTTGTATATGCATGGCAAAGAGCTGTTAACCCTGATACGGCAGCGAAATCAGGATATATTATGCTTGATG TGAAAAATGCAGAGAAAATTAATAAAAGGGAGCTATCACCGGATCAATTAGGTGTAAAAGCGATAGATGATTATACATTT GAAGTTGAATTGGATAATCCAGTTCCATATTTTCTTGATTTAACGGTGTACCCACTATTTTTCCCATTAAATGAGAAGTA TATGAAAGAACAGGGAGAAAAATTTGGTTTAGAAGCAAATACAACTTTGTATAACGGTCCATTTGTATTAAATGAATGGA AACATGAACAAAGTTTCCAATTAAAGAAAAATCCAAGCTATTGGGATCAAAAAGAAGTAAAATTAGAAGAAGTTAATTTT AATGTTGTAAAAGATACAGGAGCAGCTGTTAATTTGTATAATACGAGTGCGATTGACAGAGTCGGTTTATCAGCTGAGTT AGTTGATAAGTATAAAGGACAACAAGACTTTAAAACAATTAATGATCCAACTGTATTCTTCTTACGTTTTAATCAAAAAA ATCCAGCTTTAGCTAACAAAAATATTCGTAAGGCTATTTCTAGTGCATACGATCGAGATGGTATTGGTGAGGTTATTTTA AACAACGGTTCTAAGGGAGCTTACGGTTTAGTACCATCTGATTTTGTTAAGGGACCAGATAAGCAAGATTTCAGAAAAGA AAATGGGAAACTTTCAAAAGTCGATGTGAAGGAAGCTAAAAAATTCTGGGAAGCTGGAAAGAAAGAATTAGGTAAAGATA AAATAGAAATAGAATTTTTAAACTTTGATAATGAAGAATCTAAGAAAATTGGTGAGTATGTAAAGGGAGAATTAGAAAAG AATTTACCAGGTCTAACAGTAACAATTAAGATGCAACCATTTGCACAAAAATTAAAACTTGAAGATAGTGGACAGTTTGA TATTTCATTTACTGGATGGGGACCTGATTTCCCTGATGCAATCACATTCCTTGATATGTTTATAACAGATGGTTCACAAA ATAAAATGGGTTATTCTAATGCTGAGTATGATAGCCTTATTAAAAAGGCAAAGCAAGAAGGTTCAGATGTAAAAGGACGT TGGAATGACCTGTTAAAAGCGGAAAAAATCTTATTTGAGGATGCAGCAATTGCACCAGTATTCCAACGTGGTAGATCTAT ATTAGAAAGAGAAACAATTAAAGATGTATATATCCACAAATATGGCGGCGAATTAAGCTTTAAGTGGGCATCTGTAGAAA AATAA
Upstream 100 bases:
>100_bases ATATATATTTCTTTTTGTTTGAAAATGAAAGGGCTAACATTTTTGTGGAGGGTGGAAGTATGAAAAAAAGATTCCAGTTT TTGTAGTATCAACAGTAGCA
Downstream 100 bases:
>100_bases AAAAGCAGGCTAACCGCCTGCTTTTTTTAATACGTACGTTTCTTATAAATACCTTTCCCGCCGACCTCGTTCCAGCCGGA TTGCACATCCAAACTTTTAT
Product: oligopeptide ABC transporter oligopeptide-binding protein
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 534; Mature: 533
Protein sequence:
>534_residues MSMMLGACSYQKDEPQANAKGDSGKSGAKQVINLTEVSEIPTMDTTLASDAASSKVMNNTMEGLYRLGKGDKLVPGVAKS HTKSEDGKKYTFKLREDAKWSNGDPVTAKDFVYAWQRAVNPDTAAKSGYIMLDVKNAEKINKRELSPDQLGVKAIDDYTF EVELDNPVPYFLDLTVYPLFFPLNEKYMKEQGEKFGLEANTTLYNGPFVLNEWKHEQSFQLKKNPSYWDQKEVKLEEVNF NVVKDTGAAVNLYNTSAIDRVGLSAELVDKYKGQQDFKTINDPTVFFLRFNQKNPALANKNIRKAISSAYDRDGIGEVIL NNGSKGAYGLVPSDFVKGPDKQDFRKENGKLSKVDVKEAKKFWEAGKKELGKDKIEIEFLNFDNEESKKIGEYVKGELEK NLPGLTVTIKMQPFAQKLKLEDSGQFDISFTGWGPDFPDAITFLDMFITDGSQNKMGYSNAEYDSLIKKAKQEGSDVKGR WNDLLKAEKILFEDAAIAPVFQRGRSILERETIKDVYIHKYGGELSFKWASVEK
Sequences:
>Translated_534_residues MSMMLGACSYQKDEPQANAKGDSGKSGAKQVINLTEVSEIPTMDTTLASDAASSKVMNNTMEGLYRLGKGDKLVPGVAKS HTKSEDGKKYTFKLREDAKWSNGDPVTAKDFVYAWQRAVNPDTAAKSGYIMLDVKNAEKINKRELSPDQLGVKAIDDYTF EVELDNPVPYFLDLTVYPLFFPLNEKYMKEQGEKFGLEANTTLYNGPFVLNEWKHEQSFQLKKNPSYWDQKEVKLEEVNF NVVKDTGAAVNLYNTSAIDRVGLSAELVDKYKGQQDFKTINDPTVFFLRFNQKNPALANKNIRKAISSAYDRDGIGEVIL NNGSKGAYGLVPSDFVKGPDKQDFRKENGKLSKVDVKEAKKFWEAGKKELGKDKIEIEFLNFDNEESKKIGEYVKGELEK NLPGLTVTIKMQPFAQKLKLEDSGQFDISFTGWGPDFPDAITFLDMFITDGSQNKMGYSNAEYDSLIKKAKQEGSDVKGR WNDLLKAEKILFEDAAIAPVFQRGRSILERETIKDVYIHKYGGELSFKWASVEK >Mature_533_residues SMMLGACSYQKDEPQANAKGDSGKSGAKQVINLTEVSEIPTMDTTLASDAASSKVMNNTMEGLYRLGKGDKLVPGVAKSH TKSEDGKKYTFKLREDAKWSNGDPVTAKDFVYAWQRAVNPDTAAKSGYIMLDVKNAEKINKRELSPDQLGVKAIDDYTFE VELDNPVPYFLDLTVYPLFFPLNEKYMKEQGEKFGLEANTTLYNGPFVLNEWKHEQSFQLKKNPSYWDQKEVKLEEVNFN VVKDTGAAVNLYNTSAIDRVGLSAELVDKYKGQQDFKTINDPTVFFLRFNQKNPALANKNIRKAISSAYDRDGIGEVILN NGSKGAYGLVPSDFVKGPDKQDFRKENGKLSKVDVKEAKKFWEAGKKELGKDKIEIEFLNFDNEESKKIGEYVKGELEKN LPGLTVTIKMQPFAQKLKLEDSGQFDISFTGWGPDFPDAITFLDMFITDGSQNKMGYSNAEYDSLIKKAKQEGSDVKGRW NDLLKAEKILFEDAAIAPVFQRGRSILERETIKDVYIHKYGGELSFKWASVEK
Specific function: Part of the binding-protein-dependent transport system for dipeptides; probably responsible for the binding of dipeptides with high affinity. Is expressed to facilitate adaptation to nutrient deficiency conditions, which also induce sporulation [H]
COG id: COG4166
COG function: function code E; ABC-type oligopeptide transport system, periplasmic component
Gene ontology:
Cell location: Cell membrane; Lipid-anchor (Probable) [H]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the bacterial solute-binding protein 5 family [H]
Homologues:
Organism=Escherichia coli, GI87081878, Length=480, Percent_Identity=30.8333333333333, Blast_Score=207, Evalue=1e-54, Organism=Escherichia coli, GI1787495, Length=509, Percent_Identity=29.4695481335953, Blast_Score=198, Evalue=8e-52, Organism=Escherichia coli, GI1789397, Length=505, Percent_Identity=27.3267326732673, Blast_Score=187, Evalue=1e-48, Organism=Escherichia coli, GI1787762, Length=458, Percent_Identity=24.4541484716157, Blast_Score=104, Evalue=2e-23, Organism=Escherichia coli, GI1787052, Length=322, Percent_Identity=24.8447204968944, Blast_Score=81, Evalue=2e-16, Organism=Escherichia coli, GI1789966, Length=506, Percent_Identity=23.7154150197628, Blast_Score=77, Evalue=2e-15, Organism=Escherichia coli, GI1789887, Length=358, Percent_Identity=23.7430167597765, Blast_Score=70, Evalue=4e-13,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR000914 [H]
Pfam domain/function: PF00496 SBP_bac_5 [H]
EC number: NA
Molecular weight: Translated: 60113; Mature: 59982
Theoretical pI: Translated: 5.76; Mature: 5.76
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.2 %Cys (Translated Protein) 2.1 %Met (Translated Protein) 2.2 %Cys+Met (Translated Protein) 0.2 %Cys (Mature Protein) 1.9 %Met (Mature Protein) 2.1 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MSMMLGACSYQKDEPQANAKGDSGKSGAKQVINLTEVSEIPTMDTTLASDAASSKVMNNT CCCEECCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHH MEGLYRLGKGDKLVPGVAKSHTKSEDGKKYTFKLREDAKWSNGDPVTAKDFVYAWQRAVN HHHHHHHCCCCEECCCCHHCCCCCCCCCEEEEEEECCCCCCCCCCCCHHHHHHHHHHHCC PDTAAKSGYIMLDVKNAEKINKRELSPDQLGVKAIDDYTFEVELDNPVPYFLDLTVYPLF CCCCCCCCEEEEEECCCHHHHHHCCCHHHCCCEEECCEEEEEEECCCCCEEEEEEEEEEE FPLNEKYMKEQGEKFGLEANTTLYNGPFVLNEWKHEQSFQLKKNPSYWDQKEVKLEEVNF ECCCHHHHHHCCHHCCCCCCCEEECCCEEEECCCCCCCEEECCCCCCCCCCCCEEEECCE NVVKDTGAAVNLYNTSAIDRVGLSAELVDKYKGQQDFKTINDPTVFFLRFNQKNPALANK EEEECCCCEEEEECCCHHHHCCCCHHHHHHHCCCHHHCCCCCCEEEEEEECCCCCCCCCH NIRKAISSAYDRDGIGEVILNNGSKGAYGLVPSDFVKGPDKQDFRKENGKLSKVDVKEAK HHHHHHHHHCCCCCCCEEEEECCCCCEECCCCHHHHCCCCHHHHHHHCCCEEEECHHHHH KFWEAGKKELGKDKIEIEFLNFDNEESKKIGEYVKGELEKNLPGLTVTIKMQPFAQKLKL HHHHHHHHHCCCCEEEEEEECCCCHHHHHHHHHHHHHHHHCCCCEEEEEEECHHHHHHCC EDSGQFDISFTGWGPDFPDAITFLDMFITDGSQNKMGYSNAEYDSLIKKAKQEGSDVKGR CCCCCEEEEEECCCCCCHHHHHHHHHHHCCCCCCCCCCCCCHHHHHHHHHHHCCCCCCCH WNDLLKAEKILFEDAAIAPVFQRGRSILERETIKDVYIHKYGGELSFKWASVEK HHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHEEEECCCCEEEEECCCCC >Mature Secondary Structure SMMLGACSYQKDEPQANAKGDSGKSGAKQVINLTEVSEIPTMDTTLASDAASSKVMNNT CCEECCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHH MEGLYRLGKGDKLVPGVAKSHTKSEDGKKYTFKLREDAKWSNGDPVTAKDFVYAWQRAVN HHHHHHHCCCCEECCCCHHCCCCCCCCCEEEEEEECCCCCCCCCCCCHHHHHHHHHHHCC PDTAAKSGYIMLDVKNAEKINKRELSPDQLGVKAIDDYTFEVELDNPVPYFLDLTVYPLF CCCCCCCCEEEEEECCCHHHHHHCCCHHHCCCEEECCEEEEEEECCCCCEEEEEEEEEEE FPLNEKYMKEQGEKFGLEANTTLYNGPFVLNEWKHEQSFQLKKNPSYWDQKEVKLEEVNF ECCCHHHHHHCCHHCCCCCCCEEECCCEEEECCCCCCCEEECCCCCCCCCCCCEEEECCE NVVKDTGAAVNLYNTSAIDRVGLSAELVDKYKGQQDFKTINDPTVFFLRFNQKNPALANK EEEECCCCEEEEECCCHHHHCCCCHHHHHHHCCCHHHCCCCCCEEEEEEECCCCCCCCCH NIRKAISSAYDRDGIGEVILNNGSKGAYGLVPSDFVKGPDKQDFRKENGKLSKVDVKEAK HHHHHHHHHCCCCCCCEEEEECCCCCEECCCCHHHHCCCCHHHHHHHCCCEEEECHHHHH KFWEAGKKELGKDKIEIEFLNFDNEESKKIGEYVKGELEKNLPGLTVTIKMQPFAQKLKL HHHHHHHHHCCCCEEEEEEECCCCHHHHHHHHHHHHHHHHCCCCEEEEEEECHHHHHHCC EDSGQFDISFTGWGPDFPDAITFLDMFITDGSQNKMGYSNAEYDSLIKKAKQEGSDVKGR CCCCCEEEEEECCCCCCHHHHHHHHHHHCCCCCCCCCCCCCHHHHHHHHHHHCCCCCCCH WNDLLKAEKILFEDAAIAPVFQRGRSILERETIKDVYIHKYGGELSFKWASVEK HHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHEEEECCCCEEEEECCCCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 6.0
TargetDB status: NA
Availability: NA
References: 1766370; 9384377 [H]