| Definition | Ruegeria sp. TM1040, complete genome. |
|---|---|
| Accession | NC_008044 |
| Length | 3,200,938 |
Click here to switch to the map view.
The map label for this gene is pepF2 [H]
Identifier: 99080410
GI number: 99080410
Start: 605508
End: 607328
Strand: Reverse
Name: pepF2 [H]
Synonym: TM1040_0569
Alternate gene names: 99080410
Gene position: 607328-605508 (Counterclockwise)
Preceding gene: 99080411
Following gene: 99080409
Centisome position: 18.97
GC content: 58.37
Gene sequence:
>1821_bases ATGTTCCAACTCCCTTTCCCTGTGCGCGATGCCAATGCCTCTTCCGGAGCCGGTGATCTTGGCAAATTGCCGGAGTGGGA TCTGAGCGATCTCTACGCAGGCGAAGACGCTGCGGAACTTTCCCGCGATCTGGACTGGCTGCAGGGTGAATGCGCTGCCT TTGCCGCCGACTACGAGGGCAAGCTTGCAGAGCTCGACGCCGAGGGGCTTCTGACCTGCGTCCATCGCAACGAAAAAATC AACAATATCGCCGGGCGCATCATGTCCTATGCGGGCCTGCGCTATTACCAGCTGACAACCGACGCGGACCGCGCCAAATT CCTCTCTGACGTGCAGGAGAAAGTCACGGTCTTCACCACGCCGCTGGTGTTCTTCACGCTGGAAATCAACCGCATCGAGG ATGCCAAACTCGACGCGCTCTTTGAGGCAAACGCCGATCTGGCGCGCTACAAACCCGTTTTTGACCGGATCCGCGCGATG AAGCCCTATCAGCTCTCGGATGAGCTGGAGCGTTTTATGCACGACCTCGGGATTGTGGGCGATGCCTGGGAAAAGCTCTT TGACGAGACCATCGCAGGGCTGACCTTTGAGATCGAGGGCGAAGAGCTCGGCATCGAGGCGACGCTCAACTTCCTGACCG AGCAGGACCGCAGCAAGCGCGAAGCCGCAGCGCGCGAACTTGCCCGCGTCTTTGCCGACAACATCAAGATCTTTGCCCGC GTTCACAACACGCAGGCCAAAGAGAAAGAGATCATTGACCGCTGGCGCGGCATGCCGAGCCCGCAGATGGGCCGGCACCT CTCGAACGATGTCGAGCCCGAAGTGGTCGAAGCTCTGCGCGAGGCCGTAGTGGCCGCCTACCCCAAGCTTTCGCACCGCT ACTATGAGCTCAAACGCAAATGGCTCGGTCTCGATCGCATGCAGGTCTGGGATCGCAACGCGCCTCTGCCGATGGAAACC ACCCGCGTGGTGGACTGGGAGGAGGCCCGCGCAACCGTGATGGAGGCCTATGAGGCCTTTGATCCACGCATGGGCGAGCT GGCGCAGCCGTTTTTCGACAAGGGCTGGATCGACGCAGGCGTCAAACCCGGCAAAGCCCCCGGTGCATTTGCTCATCCAA CAGTGACCAATGTCCATCCGTATGTGATGCTGAACTACCTGGGCAAACCGCGTGACGTGATGACGCTGGCGCATGAACTT GGCCACGGTGTTCATCAGGTTCTTGCCGCAGATCAGGGCGAGATGCTCTCTTCGACACCCCTGACCCTTGCGGAAACCGC ATCGGTCTTTGGCGAGATGCTCACTTTCCGCAAGATGCTCGAAAAGGCCCAGACCAAAGAAGAGCGCAAGGTGCTCTTGG CAGGCAAGGTCGAGGACATGATCAACACGGTCGTGCGCCAGATCGCCTTTTATGACTTTGAGTGCAAACTACACGCCGCA CGCGCCGAAGGTGAGCTTACGCCCGAAGACATCAACGCCCTCTGGATGAGTGTGCAAGCGGAGTCCCTGGGCGAGTCCTT TGACTTCATGGAAGGGTATGAGACCTTCTGGGCCTATATTCCGCACTTCGTCCACTCGCCCTTCTACGTCTATGCCTATG CATTTGGCGATGGCCTCGTGAACGCGCTTTACTCGGTCTATGCCGAAGGGGCCGAGGGATTTGAGGACAAGTATTTCGAC ATGCTCAAGGCTGGCGGGTCCAAACATCACAAAGAGCTTTTGGCACCATTTGGTCTTGATGCCTCTGACCCCAAGTTCTG GGACAAAGGCCTGTCGATGATCTCTGGCCTGATTGACGAGCTTGAGGCAATGGAAGCTTGA
Upstream 100 bases:
>100_bases CGCTTGCCCGACCTAAGTGTTTGAAGAACAGATCCACGGGAGCGCGCGCCGCTTTTTGCTGCGCGCCTGCGCCCAAATTC AGACATCAGACGGAGGTCAC
Downstream 100 bases:
>100_bases TCCGGAGTTAGGCTTCTCGGTAATTTGAAATGGCTCCCATTTGGGAGCCATTTTTACATCAGGAACGATTTTCTCATGGC GATTTTAACTTCAAGCGACT
Product: peptidase M3B, oligoendopeptidase-related clade 3
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 606; Mature: 606
Protein sequence:
>606_residues MFQLPFPVRDANASSGAGDLGKLPEWDLSDLYAGEDAAELSRDLDWLQGECAAFAADYEGKLAELDAEGLLTCVHRNEKI NNIAGRIMSYAGLRYYQLTTDADRAKFLSDVQEKVTVFTTPLVFFTLEINRIEDAKLDALFEANADLARYKPVFDRIRAM KPYQLSDELERFMHDLGIVGDAWEKLFDETIAGLTFEIEGEELGIEATLNFLTEQDRSKREAAARELARVFADNIKIFAR VHNTQAKEKEIIDRWRGMPSPQMGRHLSNDVEPEVVEALREAVVAAYPKLSHRYYELKRKWLGLDRMQVWDRNAPLPMET TRVVDWEEARATVMEAYEAFDPRMGELAQPFFDKGWIDAGVKPGKAPGAFAHPTVTNVHPYVMLNYLGKPRDVMTLAHEL GHGVHQVLAADQGEMLSSTPLTLAETASVFGEMLTFRKMLEKAQTKEERKVLLAGKVEDMINTVVRQIAFYDFECKLHAA RAEGELTPEDINALWMSVQAESLGESFDFMEGYETFWAYIPHFVHSPFYVYAYAFGDGLVNALYSVYAEGAEGFEDKYFD MLKAGGSKHHKELLAPFGLDASDPKFWDKGLSMISGLIDELEAMEA
Sequences:
>Translated_606_residues MFQLPFPVRDANASSGAGDLGKLPEWDLSDLYAGEDAAELSRDLDWLQGECAAFAADYEGKLAELDAEGLLTCVHRNEKI NNIAGRIMSYAGLRYYQLTTDADRAKFLSDVQEKVTVFTTPLVFFTLEINRIEDAKLDALFEANADLARYKPVFDRIRAM KPYQLSDELERFMHDLGIVGDAWEKLFDETIAGLTFEIEGEELGIEATLNFLTEQDRSKREAAARELARVFADNIKIFAR VHNTQAKEKEIIDRWRGMPSPQMGRHLSNDVEPEVVEALREAVVAAYPKLSHRYYELKRKWLGLDRMQVWDRNAPLPMET TRVVDWEEARATVMEAYEAFDPRMGELAQPFFDKGWIDAGVKPGKAPGAFAHPTVTNVHPYVMLNYLGKPRDVMTLAHEL GHGVHQVLAADQGEMLSSTPLTLAETASVFGEMLTFRKMLEKAQTKEERKVLLAGKVEDMINTVVRQIAFYDFECKLHAA RAEGELTPEDINALWMSVQAESLGESFDFMEGYETFWAYIPHFVHSPFYVYAYAFGDGLVNALYSVYAEGAEGFEDKYFD MLKAGGSKHHKELLAPFGLDASDPKFWDKGLSMISGLIDELEAMEA >Mature_606_residues MFQLPFPVRDANASSGAGDLGKLPEWDLSDLYAGEDAAELSRDLDWLQGECAAFAADYEGKLAELDAEGLLTCVHRNEKI NNIAGRIMSYAGLRYYQLTTDADRAKFLSDVQEKVTVFTTPLVFFTLEINRIEDAKLDALFEANADLARYKPVFDRIRAM KPYQLSDELERFMHDLGIVGDAWEKLFDETIAGLTFEIEGEELGIEATLNFLTEQDRSKREAAARELARVFADNIKIFAR VHNTQAKEKEIIDRWRGMPSPQMGRHLSNDVEPEVVEALREAVVAAYPKLSHRYYELKRKWLGLDRMQVWDRNAPLPMET TRVVDWEEARATVMEAYEAFDPRMGELAQPFFDKGWIDAGVKPGKAPGAFAHPTVTNVHPYVMLNYLGKPRDVMTLAHEL GHGVHQVLAADQGEMLSSTPLTLAETASVFGEMLTFRKMLEKAQTKEERKVLLAGKVEDMINTVVRQIAFYDFECKLHAA RAEGELTPEDINALWMSVQAESLGESFDFMEGYETFWAYIPHFVHSPFYVYAYAFGDGLVNALYSVYAEGAEGFEDKYFD MLKAGGSKHHKELLAPFGLDASDPKFWDKGLSMISGLIDELEAMEA
Specific function: Hydrolyzes peptides containing between 7 and 17 amino acids with a rather wide specificity [H]
COG id: COG1164
COG function: function code E; Oligoendopeptidase F
Gene ontology:
Cell location: Cytoplasmic
Metaboloic importance: NA
Operon status: Not Known
Operon components: None
Similarity: Belongs to the peptidase M3B family [H]
Homologues:
None
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
- InterPro: IPR001567 - InterPro: IPR004438 - InterPro: IPR013647 [H]
Pfam domain/function: PF01432 Peptidase_M3; PF08439 Peptidase_M3_N [H]
EC number: NA
Molecular weight: Translated: 68456; Mature: 68456
Theoretical pI: Translated: 4.54; Mature: 4.54
Prosite motif: PS00142 ZINC_PROTEASE
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.5 %Cys (Translated Protein) 3.5 %Met (Translated Protein) 4.0 %Cys+Met (Translated Protein) 0.5 %Cys (Mature Protein) 3.5 %Met (Mature Protein) 4.0 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MFQLPFPVRDANASSGAGDLGKLPEWDLSDLYAGEDAAELSRDLDWLQGECAAFAADYEG CCCCCCCCCCCCCCCCCCCCCCCCCCCHHHHCCCCCHHHHHHHHHHHHCHHHHHHCCCCC KLAELDAEGLLTCVHRNEKINNIAGRIMSYAGLRYYQLTTDADRAKFLSDVQEKVTVFTT CHHHCCHHHHHHHHHCCCHHHHHHHHHHHHHCCEEEEECCCHHHHHHHHHHHHHHHHHEE PLVFFTLEINRIEDAKLDALFEANADLARYKPVFDRIRAMKPYQLSDELERFMHDLGIVG CEEEEEEEECCCCCHHHHHHHHCCCCHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHCCCC DAWEKLFDETIAGLTFEIEGEELGIEATLNFLTEQDRSKREAAARELARVFADNIKIFAR HHHHHHHHHHHCCCEEEECCCHHCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCHHEEEE VHNTQAKEKEIIDRWRGMPSPQMGRHLSNDVEPEVVEALREAVVAAYPKLSHRYYELKRK ECCCCHHHHHHHHHHCCCCCHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHH WLGLDRMQVWDRNAPLPMETTRVVDWEEARATVMEAYEAFDPRMGELAQPFFDKGWIDAG HHCCHHHHHHCCCCCCCCCCCEECCHHHHHHHHHHHHHHCCCCHHHHHHHHHHCCCCCCC VKPGKAPGAFAHPTVTNVHPYVMLNYLGKPRDVMTLAHELGHGVHQVLAADQGEMLSSTP CCCCCCCCCCCCCCCCCCCHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHCCCCCCCCCCC LTLAETASVFGEMLTFRKMLEKAQTKEERKVLLAGKVEDMINTVVRQIAFYDFECKLHAA CHHHHHHHHHHHHHHHHHHHHHHHCHHHHHHHHHHHHHHHHHHHHHHHHHCCCEEEEEEE RAEGELTPEDINALWMSVQAESLGESFDFMEGYETFWAYIPHFVHSPFYVYAYAFGDGLV CCCCCCCHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHCCCCEEEEEHHHHHHH NALYSVYAEGAEGFEDKYFDMLKAGGSKHHKELLAPFGLDASDPKFWDKGLSMISGLIDE HHHHHHHHCCCCCHHHHHHHHHHCCCCHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHH LEAMEA HHHHCC >Mature Secondary Structure MFQLPFPVRDANASSGAGDLGKLPEWDLSDLYAGEDAAELSRDLDWLQGECAAFAADYEG CCCCCCCCCCCCCCCCCCCCCCCCCCCHHHHCCCCCHHHHHHHHHHHHCHHHHHHCCCCC KLAELDAEGLLTCVHRNEKINNIAGRIMSYAGLRYYQLTTDADRAKFLSDVQEKVTVFTT CHHHCCHHHHHHHHHCCCHHHHHHHHHHHHHCCEEEEECCCHHHHHHHHHHHHHHHHHEE PLVFFTLEINRIEDAKLDALFEANADLARYKPVFDRIRAMKPYQLSDELERFMHDLGIVG CEEEEEEEECCCCCHHHHHHHHCCCCHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHCCCC DAWEKLFDETIAGLTFEIEGEELGIEATLNFLTEQDRSKREAAARELARVFADNIKIFAR HHHHHHHHHHHCCCEEEECCCHHCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCHHEEEE VHNTQAKEKEIIDRWRGMPSPQMGRHLSNDVEPEVVEALREAVVAAYPKLSHRYYELKRK ECCCCHHHHHHHHHHCCCCCHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHH WLGLDRMQVWDRNAPLPMETTRVVDWEEARATVMEAYEAFDPRMGELAQPFFDKGWIDAG HHCCHHHHHHCCCCCCCCCCCEECCHHHHHHHHHHHHHHCCCCHHHHHHHHHHCCCCCCC VKPGKAPGAFAHPTVTNVHPYVMLNYLGKPRDVMTLAHELGHGVHQVLAADQGEMLSSTP CCCCCCCCCCCCCCCCCCCHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHCCCCCCCCCCC LTLAETASVFGEMLTFRKMLEKAQTKEERKVLLAGKVEDMINTVVRQIAFYDFECKLHAA CHHHHHHHHHHHHHHHHHHHHHHHCHHHHHHHHHHHHHHHHHHHHHHHHHCCCEEEEEEE RAEGELTPEDINALWMSVQAESLGESFDFMEGYETFWAYIPHFVHSPFYVYAYAFGDGLV CCCCCCCHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHCCCCEEEEEHHHHHHH NALYSVYAEGAEGFEDKYFDMLKAGGSKHHKELLAPFGLDASDPKFWDKGLSMISGLIDE HHHHHHHHCCCCCHHHHHHHHHHCCCCHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHHH LEAMEA HHHHCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 9209029 [H]