Definition Bacillus subtilis subsp. subtilis str. 168 chromosome, complete genome.
Accession NC_000964
Length 4,215,606

Click here to switch to the map view.

The map label for this gene is ypeP

Identifier: 161511070

GI number: 161511070

Start: 2308967

End: 2309647

Strand: Reverse

Name: ypeP

Synonym: BSU21970

Alternate gene names: 161511070

Gene position: 2309647-2308967 (Counterclockwise)

Preceding gene: 16079259

Following gene: 16079255

Centisome position: 54.79

GC content: 45.23

Gene sequence:

>681_bases
ATGAAGCTCAGACCGCATTTGAAAATAGAAGCAAAAGGAACGGGATCCGTCTCATTTTTTAGCGAAGACTGGCTGACAGC
ACAGCAGGCACGTACGTTCGCCAGAGAACTTGGCCGTTTTCCATACATGAAGGAGCTAGAGTTCGAAGACGAGAAAGGCG
GCAGCTGGACGCTGAAGGAATTGGAAAAGCTGACAGAGGAGCTTGCTCAAGAGCCTGATGACATTACTGTTTATTTTGAC
GGCAGTTTCGATAAAGAGAGCGAACTGGCCGGTCTCGGGATCGTCATCTATTATTCATTGGGAGGAACCCGGCATCGCTT
GAGAAAAAATAAAAGCTTCCGGCTGAAAACCAATAATGAAGCTGAATACGCAGCGCTTTATGAAGCAATAAGAGAAGTAA
GAGAGCTTGGGGCAAGCAGAAATTCAATTACAATCAAAGGGGACTCGCTTGTTGTGCTGAATCAGCTTGACGGCAGCTGG
CCTTGTTATGATCCATCTCATAATGAATGGCTGGACAAAATAGAAGCACTCCTTGAATCGCTGAAGCTTACTCCAACCTA
CGAAACAATACAACGAAAAGACAATCAGGAAGCTGACGGCCTCGCTAAAAAAATTCTATCCCATCAATTCGTAGAAAGCC
ACACGAAATTAGACCGTAACGGAGATGACGATATTGGATAA

Upstream 100 bases:

>100_bases
AAACGAATTATTAAACAAGATGAAAAAGCTTCCTTTCCGGGGTAAGATTGGTTTGATTATAGCATAAGCCCGGCAACTAA
TGAATGGTAAGGTGATTGTA

Downstream 100 bases:

>100_bases
GAAAATGATCTTTAAAGAACTGACAGAACTGCACGATGAATATTGCAAGGACTGTTTTATTAAGAAGCAGTTTCGCAAAG
AATTTGGCAAAACTTATGCG

Product: hypothetical protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 226; Mature: 226

Protein sequence:

>226_residues
MKLRPHLKIEAKGTGSVSFFSEDWLTAQQARTFARELGRFPYMKELEFEDEKGGSWTLKELEKLTEELAQEPDDITVYFD
GSFDKESELAGLGIVIYYSLGGTRHRLRKNKSFRLKTNNEAEYAALYEAIREVRELGASRNSITIKGDSLVVLNQLDGSW
PCYDPSHNEWLDKIEALLESLKLTPTYETIQRKDNQEADGLAKKILSHQFVESHTKLDRNGDDDIG

Sequences:

>Translated_226_residues
MKLRPHLKIEAKGTGSVSFFSEDWLTAQQARTFARELGRFPYMKELEFEDEKGGSWTLKELEKLTEELAQEPDDITVYFD
GSFDKESELAGLGIVIYYSLGGTRHRLRKNKSFRLKTNNEAEYAALYEAIREVRELGASRNSITIKGDSLVVLNQLDGSW
PCYDPSHNEWLDKIEALLESLKLTPTYETIQRKDNQEADGLAKKILSHQFVESHTKLDRNGDDDIG
>Mature_226_residues
MKLRPHLKIEAKGTGSVSFFSEDWLTAQQARTFARELGRFPYMKELEFEDEKGGSWTLKELEKLTEELAQEPDDITVYFD
GSFDKESELAGLGIVIYYSLGGTRHRLRKNKSFRLKTNNEAEYAALYEAIREVRELGASRNSITIKGDSLVVLNQLDGSW
PCYDPSHNEWLDKIEALLESLKLTPTYETIQRKDNQEADGLAKKILSHQFVESHTKLDRNGDDDIG

Specific function: Unknown

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Contains 1 RNase H domain

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): YPEP_BACSU (P54164)

Other databases:

- EMBL:   L77246
- EMBL:   AL009126
- PIR:   F69934
- RefSeq:   NP_390080.2
- ProteinModelPortal:   P54164
- SMR:   P54164
- EnsemblBacteria:   EBBACT00000002235
- GeneID:   939073
- GenomeReviews:   AL009126_GR
- KEGG:   bsu:BSU21970
- NMPDR:   fig|224308.1.peg.2203
- GenoList:   BSU21970
- GeneTree:   EBGT00050000002211
- HOGENOM:   HBG348997
- ProtClustDB:   PRK07708
- BioCyc:   BSUB:BSU21970-MONOMER
- InterPro:   IPR012337
- InterPro:   IPR002156

Pfam domain/function: PF00075 RnaseH; SSF53098 RNaseH_fold

EC number: NA

Molecular weight: Translated: 25853; Mature: 25853

Theoretical pI: Translated: 4.88; Mature: 4.88

Prosite motif: PS50879 RNASE_H

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.4 %Cys     (Translated Protein)
0.9 %Met     (Translated Protein)
1.3 %Cys+Met (Translated Protein)
0.4 %Cys     (Mature Protein)
0.9 %Met     (Mature Protein)
1.3 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKLRPHLKIEAKGTGSVSFFSEDWLTAQQARTFARELGRFPYMKELEFEDEKGGSWTLKE
CCCCCCEEEEECCCCCEEEEHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCHHH
LEKLTEELAQEPDDITVYFDGSFDKESELAGLGIVIYYSLGGTRHRLRKNKSFRLKTNNE
HHHHHHHHHCCCCCEEEEECCCCCCCCHHCCCEEEEEEECCCHHHHHHCCCCEEEEECCC
AEYAALYEAIREVRELGASRNSITIKGDSLVVLNQLDGSWPCYDPSHNEWLDKIEALLES
HHHHHHHHHHHHHHHHCCCCCEEEEECCCEEEEECCCCCCCCCCCCHHHHHHHHHHHHHH
LKLTPTYETIQRKDNQEADGLAKKILSHQFVESHTKLDRNGDDDIG
CCCCCCHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHCCCCCCCCCC
>Mature Secondary Structure
MKLRPHLKIEAKGTGSVSFFSEDWLTAQQARTFARELGRFPYMKELEFEDEKGGSWTLKE
CCCCCCEEEEECCCCCEEEEHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCHHH
LEKLTEELAQEPDDITVYFDGSFDKESELAGLGIVIYYSLGGTRHRLRKNKSFRLKTNNE
HHHHHHHHHCCCCCEEEEECCCCCCCCHHCCCEEEEEEECCCHHHHHHCCCCEEEEECCC
AEYAALYEAIREVRELGASRNSITIKGDSLVVLNQLDGSWPCYDPSHNEWLDKIEALLES
HHHHHHHHHHHHHHHHCCCCCEEEEECCCEEEEECCCCCCCCCCCCHHHHHHHHHHHHHH
LKLTPTYETIQRKDNQEADGLAKKILSHQFVESHTKLDRNGDDDIG
CCCCCCHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHCCCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 10.0

TargetDB status: NA

Availability: NA

References: 9384377