| Definition | Shigella boydii Sb227, complete genome. |
|---|---|
| Accession | NC_007613 |
| Length | 4,519,823 |
Click here to switch to the map view.
The map label for this gene is pepB [H]
Identifier: 161984884
GI number: 161984884
Start: 2550465
End: 2551748
Strand: Reverse
Name: pepB [H]
Synonym: SBO_2547
Alternate gene names: 161984884
Gene position: 2551748-2550465 (Counterclockwise)
Preceding gene: 82544973
Following gene: 161984885
Centisome position: 56.46
GC content: 56.39
Gene sequence:
>1284_bases ATGACAGAAGCGATGAAGATTACCCTCTCTACCCAACCTGCCGACGCGCGCTGGGGAGAAAAAGCAACTTACAGCATTAA TAATGACGGCATTACCCTGCATTTGAACGGGGCAGACGATCTGGGGCTGATCCAGCGTGCGGCGCGCAAGATTGACGGTC TGGGCATCAAGCATGTTCAGTTAAGCGGTGAAGGCTGGGATGCGGATCGCTGCTGGGCATTCTGGCAAGGTTACAAAGCC CCGAAAGGCACGCGTAAAGTGGAGTGGCCGGATCTGGACGATGCCCAGCGCCAGGAACTGGATAACCGCCTGATGATCAT CGACTGGGTGCGTGACACCATCAACGCACCGGCAGAAGAATTGGGACCATCGCAACTGGCACAGCGTGCTGTTGATCTGA TCAGCAACGTCGCGGGCGATCGTGTGACTTATCGGATCACCAAAGGCGAAGATCTGCGTGAGCAAGGTTATATGGGGCTG CACACCGTCGGACGCGCTTCAGAACGTTCTCCGGTATTGCTGGCGCTGGATTACAACCCAACTGGCGATAAAGAAGCGCC AGTGTACGCGTGCCTGGTAGGTAAAGGTATCACTTTTGACTCCGGCGGCTACAGCATCAAACAGACTGCGTTTATGGACT CGATGAAGTCGGACATGGGCGGCGCGGCAACGGTTACCGGGGCGCTGGCATTTGCCATTACGCGCGGACTGAACAAGCGC GTGAAGCTGTTCCTCTGCTGTGCGGATAACCTGATTAGCGGCAATGCGTTCAAGCTGGGCGATATCATCACCTATCGCAA CGGTAAAAAAGTTGAAGTGATGAACACTGATGCCGAAGGGCGTCTGGTGCTTGCCGATGGTCTGATTGATGCCAGTGCGC AGAAACCGGAAATGATCATTGATGCGGCGACCCTCACCGGGGCGGCGAAAACTGCGCTGGGTAATGATTATCACGCGCTG TTCAGTTTTGACGATGCGCTTGCCGGTCGTTTGCTGGCGAGTGCCTCACAAGAGAACGAACCATTCTGGCGTCTGCCGCT GGCGGAATTCCACCGCAGCCAGCTGCCGTCTAACTTTGCCGAACTGAACAATACCGGAAGCGCGGCGTATCCGGCAGGCG CGAGCACGGCGGCGGGCTTCCTGTCGCACTTTGTTGAGAACTATCAGCAAGGCTGGCTGCATATCGACTGCTCGGCGACT TACCGTAAAGCGCCGGTTGAACAGTGGTCTGCGGGCGCTACGGGACTTGGTGTGCGCACGATAGCTAATCTGTTAACGGC GTAA
Upstream 100 bases:
>100_bases GGGCTTCACTCACTTGCCGCCTTCCTGCAACGCGAATCATTTAGCGGAAAAATCCTGGGGCTGCCAACTGGCGGCCCTTT TACAAAGAAGGATAACTAAA
Downstream 100 bases:
>100_bases ACTAATATGCCGGATGCGGCGTAAACGCCTTATCCGGCCTACAAATTCTGCAAATTCAACAAATTGCGAATCCCTTGTAG GCCTGATAAGCGTAGCGCAT
Product: aminopeptidase B
Products: NA
Alternate protein names: Aminopeptidase B [H]
Number of amino acids: Translated: 427; Mature: 426
Protein sequence:
>427_residues MTEAMKITLSTQPADARWGEKATYSINNDGITLHLNGADDLGLIQRAARKIDGLGIKHVQLSGEGWDADRCWAFWQGYKA PKGTRKVEWPDLDDAQRQELDNRLMIIDWVRDTINAPAEELGPSQLAQRAVDLISNVAGDRVTYRITKGEDLREQGYMGL HTVGRASERSPVLLALDYNPTGDKEAPVYACLVGKGITFDSGGYSIKQTAFMDSMKSDMGGAATVTGALAFAITRGLNKR VKLFLCCADNLISGNAFKLGDIITYRNGKKVEVMNTDAEGRLVLADGLIDASAQKPEMIIDAATLTGAAKTALGNDYHAL FSFDDALAGRLLASASQENEPFWRLPLAEFHRSQLPSNFAELNNTGSAAYPAGASTAAGFLSHFVENYQQGWLHIDCSAT YRKAPVEQWSAGATGLGVRTIANLLTA
Sequences:
>Translated_427_residues MTEAMKITLSTQPADARWGEKATYSINNDGITLHLNGADDLGLIQRAARKIDGLGIKHVQLSGEGWDADRCWAFWQGYKA PKGTRKVEWPDLDDAQRQELDNRLMIIDWVRDTINAPAEELGPSQLAQRAVDLISNVAGDRVTYRITKGEDLREQGYMGL HTVGRASERSPVLLALDYNPTGDKEAPVYACLVGKGITFDSGGYSIKQTAFMDSMKSDMGGAATVTGALAFAITRGLNKR VKLFLCCADNLISGNAFKLGDIITYRNGKKVEVMNTDAEGRLVLADGLIDASAQKPEMIIDAATLTGAAKTALGNDYHAL FSFDDALAGRLLASASQENEPFWRLPLAEFHRSQLPSNFAELNNTGSAAYPAGASTAAGFLSHFVENYQQGWLHIDCSAT YRKAPVEQWSAGATGLGVRTIANLLTA >Mature_426_residues TEAMKITLSTQPADARWGEKATYSINNDGITLHLNGADDLGLIQRAARKIDGLGIKHVQLSGEGWDADRCWAFWQGYKAP KGTRKVEWPDLDDAQRQELDNRLMIIDWVRDTINAPAEELGPSQLAQRAVDLISNVAGDRVTYRITKGEDLREQGYMGLH TVGRASERSPVLLALDYNPTGDKEAPVYACLVGKGITFDSGGYSIKQTAFMDSMKSDMGGAATVTGALAFAITRGLNKRV KLFLCCADNLISGNAFKLGDIITYRNGKKVEVMNTDAEGRLVLADGLIDASAQKPEMIIDAATLTGAAKTALGNDYHALF SFDDALAGRLLASASQENEPFWRLPLAEFHRSQLPSNFAELNNTGSAAYPAGASTAAGFLSHFVENYQQGWLHIDCSATY RKAPVEQWSAGATGLGVRTIANLLTA
Specific function: Probably plays an important role in intracellular peptide degradation [H]
COG id: COG0260
COG function: function code E; Leucyl aminopeptidase
Gene ontology:
Cell location: Cytoplasm [H]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the peptidase M17 family [H]
Homologues:
Organism=Homo sapiens, GI41393561, Length=317, Percent_Identity=36.2776025236593, Blast_Score=179, Evalue=5e-45, Organism=Homo sapiens, GI47155554, Length=286, Percent_Identity=36.013986013986, Blast_Score=138, Evalue=9e-33, Organism=Escherichia coli, GI87082123, Length=427, Percent_Identity=99.2974238875878, Blast_Score=874, Evalue=0.0, Organism=Escherichia coli, GI1790710, Length=315, Percent_Identity=38.0952380952381, Blast_Score=186, Evalue=2e-48, Organism=Caenorhabditis elegans, GI17556903, Length=327, Percent_Identity=33.0275229357798, Blast_Score=140, Evalue=2e-33, Organism=Caenorhabditis elegans, GI17565172, Length=207, Percent_Identity=28.9855072463768, Blast_Score=79, Evalue=6e-15, Organism=Drosophila melanogaster, GI221379063, Length=344, Percent_Identity=32.5581395348837, Blast_Score=161, Evalue=6e-40, Organism=Drosophila melanogaster, GI221379062, Length=344, Percent_Identity=32.5581395348837, Blast_Score=161, Evalue=6e-40, Organism=Drosophila melanogaster, GI21357381, Length=344, Percent_Identity=32.5581395348837, Blast_Score=161, Evalue=7e-40, Organism=Drosophila melanogaster, GI21355725, Length=289, Percent_Identity=30.1038062283737, Blast_Score=126, Evalue=2e-29, Organism=Drosophila melanogaster, GI24661038, Length=320, Percent_Identity=28.75, Blast_Score=125, Evalue=4e-29, Organism=Drosophila melanogaster, GI24662227, Length=322, Percent_Identity=28.2608695652174, Blast_Score=122, Evalue=5e-28, Organism=Drosophila melanogaster, GI161077148, Length=344, Percent_Identity=28.1976744186047, Blast_Score=117, Evalue=1e-26, Organism=Drosophila melanogaster, GI20130057, Length=344, Percent_Identity=28.1976744186047, Blast_Score=117, Evalue=1e-26, Organism=Drosophila melanogaster, GI20129969, Length=294, Percent_Identity=28.9115646258503, Blast_Score=116, Evalue=3e-26, Organism=Drosophila melanogaster, GI21355645, Length=292, Percent_Identity=27.0547945205479, Blast_Score=112, Evalue=5e-25, Organism=Drosophila melanogaster, GI24662223, Length=292, Percent_Identity=27.0547945205479, Blast_Score=112, Evalue=5e-25, Organism=Drosophila melanogaster, GI20129963, Length=316, Percent_Identity=27.2151898734177, Blast_Score=103, Evalue=2e-22, Organism=Drosophila melanogaster, GI19922386, Length=311, Percent_Identity=26.6881028938907, Blast_Score=102, Evalue=5e-22, Organism=Drosophila melanogaster, GI24646701, Length=318, Percent_Identity=25.7861635220126, Blast_Score=74, Evalue=3e-13, Organism=Drosophila melanogaster, GI24646703, Length=318, Percent_Identity=25.7861635220126, Blast_Score=74, Evalue=3e-13, Organism=Drosophila melanogaster, GI21358201, Length=318, Percent_Identity=25.7861635220126, Blast_Score=74, Evalue=3e-13,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR008330 - InterPro: IPR011356 - InterPro: IPR000819 [H]
Pfam domain/function: PF00883 Peptidase_M17 [H]
EC number: =3.4.11.23 [H]
Molecular weight: Translated: 46241; Mature: 46109
Theoretical pI: Translated: 5.48; Mature: 5.48
Prosite motif: PS00631 CYTOSOL_AP
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.2 %Cys (Translated Protein) 2.1 %Met (Translated Protein) 3.3 %Cys+Met (Translated Protein) 1.2 %Cys (Mature Protein) 1.9 %Met (Mature Protein) 3.1 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MTEAMKITLSTQPADARWGEKATYSINNDGITLHLNGADDLGLIQRAARKIDGLGIKHVQ CCCEEEEEEECCCCCCCCCCCEEEEECCCCEEEEECCCCCHHHHHHHHHHHCCCCEEEEE LSGEGWDADRCWAFWQGYKAPKGTRKVEWPDLDDAQRQELDNRLMIIDWVRDTINAPAEE ECCCCCCHHHHHHHHCCCCCCCCCCCCCCCCCCHHHHHHHCCCEEEEEEHHHHHCCCHHH LGPSQLAQRAVDLISNVAGDRVTYRITKGEDLREQGYMGLHTVGRASERSPVLLALDYNP CCHHHHHHHHHHHHHHCCCCEEEEEEECCCCHHHCCCCCEEHHCCCCCCCCEEEEEECCC TGDKEAPVYACLVGKGITFDSGGYSIKQTAFMDSMKSDMGGAATVTGALAFAITRGLNKR CCCCCCCEEEEEECCCEEECCCCCEEHHHHHHHHHHHCCCCHHHHHHHHHHHHHHCCCCE VKLFLCCADNLISGNAFKLGDIITYRNGKKVEVMNTDAEGRLVLADGLIDASAQKPEMII EEEEEEECCCCCCCCCEEECCEEEECCCCEEEEEECCCCCEEEEECCCCCCCCCCCCEEE DAATLTGAAKTALGNDYHALFSFDDALAGRLLASASQENEPFWRLPLAEFHRSQLPSNFA EEHHHCCHHHHHCCCCEEEEEECCHHHHHHHHHHCCCCCCCEEECCHHHHHHHHCCHHHH ELNNTGSAAYPAGASTAAGFLSHFVENYQQGWLHIDCSATYRKAPVEQWSAGATGLGVRT HHCCCCCCCCCCCCHHHHHHHHHHHHHHHCCCEEEEECCCHHCCCHHHHCCCCCCCHHHH IANLLTA HHHHHCC >Mature Secondary Structure TEAMKITLSTQPADARWGEKATYSINNDGITLHLNGADDLGLIQRAARKIDGLGIKHVQ CCEEEEEEECCCCCCCCCCCEEEEECCCCEEEEECCCCCHHHHHHHHHHHCCCCEEEEE LSGEGWDADRCWAFWQGYKAPKGTRKVEWPDLDDAQRQELDNRLMIIDWVRDTINAPAEE ECCCCCCHHHHHHHHCCCCCCCCCCCCCCCCCCHHHHHHHCCCEEEEEEHHHHHCCCHHH LGPSQLAQRAVDLISNVAGDRVTYRITKGEDLREQGYMGLHTVGRASERSPVLLALDYNP CCHHHHHHHHHHHHHHCCCCEEEEEEECCCCHHHCCCCCEEHHCCCCCCCCEEEEEECCC TGDKEAPVYACLVGKGITFDSGGYSIKQTAFMDSMKSDMGGAATVTGALAFAITRGLNKR CCCCCCCEEEEEECCCEEECCCCCEEHHHHHHHHHHHCCCCHHHHHHHHHHHHHHCCCCE VKLFLCCADNLISGNAFKLGDIITYRNGKKVEVMNTDAEGRLVLADGLIDASAQKPEMII EEEEEEECCCCCCCCCEEECCEEEECCCCEEEEEECCCCCEEEEECCCCCCCCCCCCEEE DAATLTGAAKTALGNDYHALFSFDDALAGRLLASASQENEPFWRLPLAEFHRSQLPSNFA EEHHHCCHHHHHCCCCEEEEEECCHHHHHHHHHHCCCCCCCEEECCHHHHHHHHCCHHHH ELNNTGSAAYPAGASTAAGFLSHFVENYQQGWLHIDCSATYRKAPVEQWSAGATGLGVRT HHCCCCCCCCCCCCHHHHHHHHHHHHHHHCCCEEEEECCCHHCCCHHHHCCCCCCCHHHH IANLLTA HHHHHCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 11206551; 11258796 [H]