Definition Petrotoga mobilis SJ95 chromosome, complete genome.
Accession NC_010003
Length 2,169,548

Click here to switch to the map view.

The map label for this gene is sapA [C]

Identifier: 160901966

GI number: 160901966

Start: 528855

End: 530585

Strand: Direct

Name: sapA [C]

Synonym: Pmob_0488

Alternate gene names: 160901966

Gene position: 528855-530585 (Clockwise)

Preceding gene: 160901965

Following gene: 160901967

Centisome position: 24.38

GC content: 39.51

Gene sequence:

>1731_bases
ATGAAAAAAGCGTTTGTTGTGTTTCTTTTATTGGCAAGTTTGGTTATGGGAAGCGCGTTATTCGCTCAAGTAACCCAAAT
CCCCAGAGAAGAAGCAGTGTATGTCGCAGGTTTTCAGTGGGGACCACCAACAACGGATAATCCGCTTGCAGGTGGGCCAA
TGACGTTCGTTTCTGATCCTAGACAACATATTTGGATATATGAAACATTATTCACATGGGATGCCCTCAATGGAAAGTAT
GTTCCTATTTTGGGAGAATCCTATAAGTGGGTTGATGAACTAAGATTAGAGGTAAAAGTAAATCCAAAAGCGTATTTCCA
CGATGGAGAACCCGTTACTGCAGATGATGTTGTATATTCCTACAAATTAGGGCAAAAATATCCACTAGGTCTTCAGATTT
GGGAATGGTTGAAAGATGTTTACAAGGTAGATAACCACACTGTAATCTTCGAGATGAAACCAGATAATCCAAACAGATTG
ATGGTAGAAGACGCACTTGGAGCTACCTTCATTCTTCCAGAACATATTTGGTCTAAGGTTGAAGCAGAAAATAATTATGA
TTTGACCAAAATCAGACAGTTTAGAAATGAAAATCCTGTAGGCTCTGGTCCATACAAAGTTTTTTATGAAAGTCCAGAAA
CTATTATTTTAGTAAGAGTAGATAATTATTGGGGAAACGAAGCTTTACACGGTGGGAAAAAACCCGCAGCTAAATACATA
GTGCATCCTATTTTCAAAAGTAATGACGAAGGTAGTTTGGCCTTTGAAAATGGTGAAGTAGACGTTTCTCAGCAATTCAC
TCCAAGAATATGGGAAATGTGGGAAAAGAAAGGGCTTCCTGTTGGTACATGGTACGACGAGATCCCTTATCATATGCCTG
CAACAATGCCTTCGTTGTGGTTTAACGTGAACAAATATCCTCTCAGTTTGCCTGAAGTTAGAAAAGCTATTGCATATTCG
GTAAATTACGCAAGAATTTCCGAACTTGCCATGTCTAATTATTCTCCTAAGGTTCAAGCCAGTCTTATAATGCCCTACGG
TGGTGAAGCAAAATACTTCGATGAAAACTTGGTAAAACAATACGGTTGGGAATACAATCCGAAAGAAGCTATAAGGATAT
TAGAAGAAGATTTGGGAGCAACAAAAGGTAAAGATGGAATATATGTTCTTCCTGATGGAACAAGACTTGGCCCATTTACC
GTAGAATGCCCATACGGTTGGACAGACTGGAATGCTTCTTTACAAATCGTGGCACAAGGAGCAAGAGCAGTAGGTATAGA
CATCCAAACATCTTTCCCTGATGCACCTATAGCTTATGATAACAGACAAACAGGTAACTTCGATATGACGATGTGGGCAC
CTTCACAACCTGGACCTGCTCAACCCTGGTTGAGATTCCAAATAGCTCTTTATTCAAAAGGTGTTCCCCCAGTTGGACAA
ATCGCATACAGTAACTTCGGAAGATATAAAAATGAATGGGCTGACCAACTCATCGATATGATTCCAAAAGTTACCGACGA
AAAAGAATTAAAGAATCTCTATACAGAGTTAGATCAACTATACAGAGAAGATATACCGATGTTCCCGTTAATGTATAGAC
CTCAAACATTTTACGAATACAATGAAACTTACTGGACAGGTTGGGCAAACGCAAAAAATCCTTATGCACCACCGATGCCT
TTGGTAGGTGCAGGGATGGAAATGTTGTGGCATTTAGAACCTGCTAAATAA

Upstream 100 bases:

>100_bases
AAGCTGGGATGTTAAAGGGAGATAGGGGAATTTAATATAATTTTTTCATGGAAAGGCCTTTCCTTGATAATGTAACAAAA
ATATTGGAGCTGAAAAGAGT

Downstream 100 bases:

>100_bases
AGTAATTTATTATCCGTCGATTAAGCCAAGAGTTCGTGGAGGAAGTTTCAGCCTCCATGAACTCTTTTAAATATACCTTC
GAGAGGTGAAATATGTGAAA

Product: extracellular solute-binding protein

Products: ADP; phosphate; peptides [Cytoplasm] [C]

Alternate protein names: Oligopeptide ABC Transporter; Dipeptide ABC Transporter Periplasmic Protein; Twin-Arginine Translocation Pathway Signal; ABC-Type Dipeptide Transport System; ABC-Type Transport System Periplasmic Component; ABC Transporter ; ABC Transporter; Dipeptide ABC Transporter; AppA Protein; Radical SAM Domain-Containing Protein; ABC-Type Peptide Transport System Periplasmic Component; Abc-Type Dipeptide Transport System Periplasmic Component; Peptide ABC Transporter

Number of amino acids: Translated: 576; Mature: 576

Protein sequence:

>576_residues
MKKAFVVFLLLASLVMGSALFAQVTQIPREEAVYVAGFQWGPPTTDNPLAGGPMTFVSDPRQHIWIYETLFTWDALNGKY
VPILGESYKWVDELRLEVKVNPKAYFHDGEPVTADDVVYSYKLGQKYPLGLQIWEWLKDVYKVDNHTVIFEMKPDNPNRL
MVEDALGATFILPEHIWSKVEAENNYDLTKIRQFRNENPVGSGPYKVFYESPETIILVRVDNYWGNEALHGGKKPAAKYI
VHPIFKSNDEGSLAFENGEVDVSQQFTPRIWEMWEKKGLPVGTWYDEIPYHMPATMPSLWFNVNKYPLSLPEVRKAIAYS
VNYARISELAMSNYSPKVQASLIMPYGGEAKYFDENLVKQYGWEYNPKEAIRILEEDLGATKGKDGIYVLPDGTRLGPFT
VECPYGWTDWNASLQIVAQGARAVGIDIQTSFPDAPIAYDNRQTGNFDMTMWAPSQPGPAQPWLRFQIALYSKGVPPVGQ
IAYSNFGRYKNEWADQLIDMIPKVTDEKELKNLYTELDQLYREDIPMFPLMYRPQTFYEYNETYWTGWANAKNPYAPPMP
LVGAGMEMLWHLEPAK

Sequences:

>Translated_576_residues
MKKAFVVFLLLASLVMGSALFAQVTQIPREEAVYVAGFQWGPPTTDNPLAGGPMTFVSDPRQHIWIYETLFTWDALNGKY
VPILGESYKWVDELRLEVKVNPKAYFHDGEPVTADDVVYSYKLGQKYPLGLQIWEWLKDVYKVDNHTVIFEMKPDNPNRL
MVEDALGATFILPEHIWSKVEAENNYDLTKIRQFRNENPVGSGPYKVFYESPETIILVRVDNYWGNEALHGGKKPAAKYI
VHPIFKSNDEGSLAFENGEVDVSQQFTPRIWEMWEKKGLPVGTWYDEIPYHMPATMPSLWFNVNKYPLSLPEVRKAIAYS
VNYARISELAMSNYSPKVQASLIMPYGGEAKYFDENLVKQYGWEYNPKEAIRILEEDLGATKGKDGIYVLPDGTRLGPFT
VECPYGWTDWNASLQIVAQGARAVGIDIQTSFPDAPIAYDNRQTGNFDMTMWAPSQPGPAQPWLRFQIALYSKGVPPVGQ
IAYSNFGRYKNEWADQLIDMIPKVTDEKELKNLYTELDQLYREDIPMFPLMYRPQTFYEYNETYWTGWANAKNPYAPPMP
LVGAGMEMLWHLEPAK
>Mature_576_residues
MKKAFVVFLLLASLVMGSALFAQVTQIPREEAVYVAGFQWGPPTTDNPLAGGPMTFVSDPRQHIWIYETLFTWDALNGKY
VPILGESYKWVDELRLEVKVNPKAYFHDGEPVTADDVVYSYKLGQKYPLGLQIWEWLKDVYKVDNHTVIFEMKPDNPNRL
MVEDALGATFILPEHIWSKVEAENNYDLTKIRQFRNENPVGSGPYKVFYESPETIILVRVDNYWGNEALHGGKKPAAKYI
VHPIFKSNDEGSLAFENGEVDVSQQFTPRIWEMWEKKGLPVGTWYDEIPYHMPATMPSLWFNVNKYPLSLPEVRKAIAYS
VNYARISELAMSNYSPKVQASLIMPYGGEAKYFDENLVKQYGWEYNPKEAIRILEEDLGATKGKDGIYVLPDGTRLGPFT
VECPYGWTDWNASLQIVAQGARAVGIDIQTSFPDAPIAYDNRQTGNFDMTMWAPSQPGPAQPWLRFQIALYSKGVPPVGQ
IAYSNFGRYKNEWADQLIDMIPKVTDEKELKNLYTELDQLYREDIPMFPLMYRPQTFYEYNETYWTGWANAKNPYAPPMP
LVGAGMEMLWHLEPAK

Specific function: Involved In A Peptide Intake Transport System That Plays A Role In The Resistance To Antimicrobial Peptides. [C]

COG id: COG0747

COG function: function code E; ABC-type dipeptide transport system, periplasmic component

Gene ontology:

Cell location: Periplasmic Protein [C]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

Organism=Escherichia coli, GI87082063, Length=267, Percent_Identity=25.4681647940075, Blast_Score=64, Evalue=4e-11,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 66041; Mature: 66041

Theoretical pI: Translated: 4.80; Mature: 4.80

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.2 %Cys     (Translated Protein)
3.1 %Met     (Translated Protein)
3.3 %Cys+Met (Translated Protein)
0.2 %Cys     (Mature Protein)
3.1 %Met     (Mature Protein)
3.3 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKKAFVVFLLLASLVMGSALFAQVTQIPREEAVYVAGFQWGPPTTDNPLAGGPMTFVSDP
CCHHHHHHHHHHHHHHHHHHHHHHHHCCCCCEEEEEEEECCCCCCCCCCCCCCCHHCCCC
RQHIWIYETLFTWDALNGKYVPILGESYKWVDELRLEVKVNPKAYFHDGEPVTADDVVYS
CCEEEEEEEEEEEECCCCEEEEEECCCCCCCEEEEEEEEECCEEEEECCCCCCHHHEEEE
YKLGQKYPLGLQIWEWLKDVYKVDNHTVIFEMKPDNPNRLMVEDALGATFILPEHIWSKV
EECCCCCCCCHHHHHHHHHHHHCCCCEEEEEECCCCCCEEEEECCCCCEEEEHHHHHHHH
EAENNYDLTKIRQFRNENPVGSGPYKVFYESPETIILVRVDNYWGNEALHGGKKPAAKYI
CCCCCCCHHHHHHHHCCCCCCCCCEEEEEECCCEEEEEEECCCCCCHHHCCCCCCCHHHH
VHPIFKSNDEGSLAFENGEVDVSQQFTPRIWEMWEKKGLPVGTWYDEIPYHMPATMPSLW
EEHHHCCCCCCCEEEECCCEEECCCCCHHHHHHHHHCCCCCCCCHHCCCCCCCCCCHHHH
FNVNKYPLSLPEVRKAIAYSVNYARISELAMSNYSPKVQASLIMPYGGEAKYFDENLVKQ
EECCCCCCCHHHHHHHHHHHCCHHHHHHHHHCCCCCCEEEEEEECCCCCCCHHHHHHHHH
YGWEYNPKEAIRILEEDLGATKGKDGIYVLPDGTRLGPFTVECPYGWTDWNASLQIVAQG
CCCCCCHHHHHHHHHHHHCCCCCCCCEEECCCCCCCCCEEEECCCCCCCCCCEEEEEECC
ARAVGIDIQTSFPDAPIAYDNRQTGNFDMTMWAPSQPGPAQPWLRFQIALYSKGVPPVGQ
CEEEEEEEECCCCCCCCCCCCCCCCCEEEEEECCCCCCCCCCCEEEEEEEECCCCCCHHH
IAYSNFGRYKNEWADQLIDMIPKVTDEKELKNLYTELDQLYREDIPMFPLMYRPQTFYEY
HHHHHCCCHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHCCCCCCEEECCCCEEEC
NETYWTGWANAKNPYAPPMPLVGAGMEMLWHLEPAK
CCEEEECCCCCCCCCCCCCCHHHCCCEEEEEECCCC
>Mature Secondary Structure
MKKAFVVFLLLASLVMGSALFAQVTQIPREEAVYVAGFQWGPPTTDNPLAGGPMTFVSDP
CCHHHHHHHHHHHHHHHHHHHHHHHHCCCCCEEEEEEEECCCCCCCCCCCCCCCHHCCCC
RQHIWIYETLFTWDALNGKYVPILGESYKWVDELRLEVKVNPKAYFHDGEPVTADDVVYS
CCEEEEEEEEEEEECCCCEEEEEECCCCCCCEEEEEEEEECCEEEEECCCCCCHHHEEEE
YKLGQKYPLGLQIWEWLKDVYKVDNHTVIFEMKPDNPNRLMVEDALGATFILPEHIWSKV
EECCCCCCCCHHHHHHHHHHHHCCCCEEEEEECCCCCCEEEEECCCCCEEEEHHHHHHHH
EAENNYDLTKIRQFRNENPVGSGPYKVFYESPETIILVRVDNYWGNEALHGGKKPAAKYI
CCCCCCCHHHHHHHHCCCCCCCCCEEEEEECCCEEEEEEECCCCCCHHHCCCCCCCHHHH
VHPIFKSNDEGSLAFENGEVDVSQQFTPRIWEMWEKKGLPVGTWYDEIPYHMPATMPSLW
EEHHHCCCCCCCEEEECCCEEECCCCCHHHHHHHHHCCCCCCCCHHCCCCCCCCCCHHHH
FNVNKYPLSLPEVRKAIAYSVNYARISELAMSNYSPKVQASLIMPYGGEAKYFDENLVKQ
EECCCCCCCHHHHHHHHHHHCCHHHHHHHHHCCCCCCEEEEEEECCCCCCCHHHHHHHHH
YGWEYNPKEAIRILEEDLGATKGKDGIYVLPDGTRLGPFTVECPYGWTDWNASLQIVAQG
CCCCCCHHHHHHHHHHHHCCCCCCCCEEECCCCCCCCCEEEECCCCCCCCCCEEEEEECC
ARAVGIDIQTSFPDAPIAYDNRQTGNFDMTMWAPSQPGPAQPWLRFQIALYSKGVPPVGQ
CEEEEEEEECCCCCCCCCCCCCCCCCEEEEEECCCCCCCCCCCEEEEEEEECCCCCCHHH
IAYSNFGRYKNEWADQLIDMIPKVTDEKELKNLYTELDQLYREDIPMFPLMYRPQTFYEY
HHHHHCCCHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHCCCCCCEEECCCCEEEC
NETYWTGWANAKNPYAPPMPLVGAGMEMLWHLEPAK
CCEEEECCCCCCCCCCCCCCHHHCCCEEEEEECCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: ATP; peptides [Periplasm]; H2O [C]

Specific reaction: ATP + peptides [Periplasm] + H2O = ADP + phosphate + peptides [Cytoplasm] [C]

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA