Definition Clostridium difficile 630 chromosome, complete genome.
Accession NC_009089
Length 4,290,252

Click here to switch to the map view.

The map label for this gene is appA [H]

Identifier: 126698725

GI number: 126698725

Start: 1330380

End: 1332095

Strand: Direct

Name: appA [H]

Synonym: CD1131

Alternate gene names: 126698725

Gene position: 1330380-1332095 (Clockwise)

Preceding gene: 126698724

Following gene: 126698726

Centisome position: 31.01

GC content: 26.75

Gene sequence:

>1716_bases
ATGAAGAGAATAAAAGTCTTAACAGTCGTTTTAGCTATAACTTTTATGGTAGCTGGTTGTAGTAATACTAAAACAAAACA
AAGTAGTAGTGATTCAAGTTTACAAAGTCAAAGTTCGATAGATGCTAAGTATATAAACTTAACAATGGTAACTCCAAAAA
CTATAAATCCTATAACTAATACTGATAAGTCTGTTGGTTATATAATGAATTTAGTTTATGATAGTTTATTTACTATAGAT
GAGAACTACAATGTAATTCCTCAATTAGTTAAGGAGTATAATATAGCTCAGGATGGAATGAGTATAGATATAAAGCTAAA
AGATGCAAAGTGGCATGATGGAAAAAATGTTACTTCAAATGATGTAAACTATACTATTGGTTTAATTCAAAAAAGTGCAG
ATAGTCCATATAATGAATTTACTAAAAATATAGCTTCTGTGAATATTAAATCAGATAAAGATTTTACAATAAAATTTAAA
GCTAGATATGCTTTTTCAATTGATAGTTTAATTTTTCCAATTGTATCTCAAAATCATTTAGATTCAAAAGATGTAAATGA
CAAGAATAATAATATGATAGGAAATGGGAAATATAAAATAGAATCATATACAGAAAGAGAAGGAATGGTTTTATCTGTAA
ACAAAGATTACTATGAAGAAGTTCCAAAAACCATGAAGAACATAAAAGTAGGTATGGTGCCTAATGAAGATGCAAGGACA
TCTATGGTTATGGCTCTTGATAGTGATATAACCAATGTTACATTAAATGATTTAAGTAAGTTTCAAGAAAAAGAGTTTAA
TATAACAAAATATCAAGGAAGAGATTATGAGTGTGTATTATTTAATTATAATAATCCTTTTTTCAAAGATGTTAATTTTA
GAAAAGCAATTGCACACTCTATAGATAAAGATAGAATTATTAGTGAAGGTTATATGGATGATGCTACTCCAGTTAATTTT
CCACTTAATTCAAAATCAAAATACTATAATAGTGAAATGAAGGATTTAGAGTTTAATAAAGATAAGGCGATAGAGTGTCT
TGCTAAGGTAGAATATGCAAATGTAAACTCAGTAAATCAAAATGACAATAAAGTAAAAAATCAGAAAAAATCAGCTAAAA
AGAACTCAAAGAAGCTTACGCCAGAAGAAGAAGCAAAAGCTAAAAAAGCAGAAGAAGATAGAATCAAAAAAGAAGCTGAA
GAGAAAAAAAATAGAGAAAAAGAGGAAGTAAAGAAAAGTCTTTCTGAAATGAACTTAAAGATAATAGTAAACAGAGATAA
TAGTGAGAGAATAAAAACTGCAAACATAATAAATGAAAACTTAAAAGCTATAGGAATAAATAGTACAGTAAATCAGCTGT
CAGATAAGGATATGGAAAATGCTCTTAATTCTAAAAATTATGATTTAGCATTAGTTGGATGGAAACTATCAATTATACCA
GATGCAAGTAGTATTATAGCGAGTAGTGGATATACTGATGATAAGTTAAATGGATATATGTCTGCACTTACAAGTTCTAC
GTCTGAAATTGAAACAAAAAAAGCATACAAAGATGTACAGACATATATAAAAGATAATGCAACATTTATAAGTTTAGCTG
TGAGAAACAACTATATTGTAAGTAATAGTAGATTAAAAGGTAAAATTACTCCAAATGATTTTGATGTATATGAGGGAATA
TCTAATTTAGATATAAAATCGAATGAATCAAATTAA

Upstream 100 bases:

>100_bases
TACATGATATACCTTTTAAGCAAACTTCAAAATATGTAGAAAAAGTAAAAAATAATTACGAACATTATAATAAGATATAT
GGCAAGAAAGGAAAAAACTA

Downstream 100 bases:

>100_bases
ATGATTAATTTCTATTTAAAAAGTATAAACTATATGATAGAATACCCTTATAGGGTATAAGGAGGTAATTAAATGAAGAA
GAAACTATTAGTAGAAGGTA

Product: solute-binding lipoprotein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 571; Mature: 571

Protein sequence:

>571_residues
MKRIKVLTVVLAITFMVAGCSNTKTKQSSSDSSLQSQSSIDAKYINLTMVTPKTINPITNTDKSVGYIMNLVYDSLFTID
ENYNVIPQLVKEYNIAQDGMSIDIKLKDAKWHDGKNVTSNDVNYTIGLIQKSADSPYNEFTKNIASVNIKSDKDFTIKFK
ARYAFSIDSLIFPIVSQNHLDSKDVNDKNNNMIGNGKYKIESYTEREGMVLSVNKDYYEEVPKTMKNIKVGMVPNEDART
SMVMALDSDITNVTLNDLSKFQEKEFNITKYQGRDYECVLFNYNNPFFKDVNFRKAIAHSIDKDRIISEGYMDDATPVNF
PLNSKSKYYNSEMKDLEFNKDKAIECLAKVEYANVNSVNQNDNKVKNQKKSAKKNSKKLTPEEEAKAKKAEEDRIKKEAE
EKKNREKEEVKKSLSEMNLKIIVNRDNSERIKTANIINENLKAIGINSTVNQLSDKDMENALNSKNYDLALVGWKLSIIP
DASSIIASSGYTDDKLNGYMSALTSSTSEIETKKAYKDVQTYIKDNATFISLAVRNNYIVSNSRLKGKITPNDFDVYEGI
SNLDIKSNESN

Sequences:

>Translated_571_residues
MKRIKVLTVVLAITFMVAGCSNTKTKQSSSDSSLQSQSSIDAKYINLTMVTPKTINPITNTDKSVGYIMNLVYDSLFTID
ENYNVIPQLVKEYNIAQDGMSIDIKLKDAKWHDGKNVTSNDVNYTIGLIQKSADSPYNEFTKNIASVNIKSDKDFTIKFK
ARYAFSIDSLIFPIVSQNHLDSKDVNDKNNNMIGNGKYKIESYTEREGMVLSVNKDYYEEVPKTMKNIKVGMVPNEDART
SMVMALDSDITNVTLNDLSKFQEKEFNITKYQGRDYECVLFNYNNPFFKDVNFRKAIAHSIDKDRIISEGYMDDATPVNF
PLNSKSKYYNSEMKDLEFNKDKAIECLAKVEYANVNSVNQNDNKVKNQKKSAKKNSKKLTPEEEAKAKKAEEDRIKKEAE
EKKNREKEEVKKSLSEMNLKIIVNRDNSERIKTANIINENLKAIGINSTVNQLSDKDMENALNSKNYDLALVGWKLSIIP
DASSIIASSGYTDDKLNGYMSALTSSTSEIETKKAYKDVQTYIKDNATFISLAVRNNYIVSNSRLKGKITPNDFDVYEGI
SNLDIKSNESN
>Mature_571_residues
MKRIKVLTVVLAITFMVAGCSNTKTKQSSSDSSLQSQSSIDAKYINLTMVTPKTINPITNTDKSVGYIMNLVYDSLFTID
ENYNVIPQLVKEYNIAQDGMSIDIKLKDAKWHDGKNVTSNDVNYTIGLIQKSADSPYNEFTKNIASVNIKSDKDFTIKFK
ARYAFSIDSLIFPIVSQNHLDSKDVNDKNNNMIGNGKYKIESYTEREGMVLSVNKDYYEEVPKTMKNIKVGMVPNEDART
SMVMALDSDITNVTLNDLSKFQEKEFNITKYQGRDYECVLFNYNNPFFKDVNFRKAIAHSIDKDRIISEGYMDDATPVNF
PLNSKSKYYNSEMKDLEFNKDKAIECLAKVEYANVNSVNQNDNKVKNQKKSAKKNSKKLTPEEEAKAKKAEEDRIKKEAE
EKKNREKEEVKKSLSEMNLKIIVNRDNSERIKTANIINENLKAIGINSTVNQLSDKDMENALNSKNYDLALVGWKLSIIP
DASSIIASSGYTDDKLNGYMSALTSSTSEIETKKAYKDVQTYIKDNATFISLAVRNNYIVSNSRLKGKITPNDFDVYEGI
SNLDIKSNESN

Specific function: This protein is a component of an oligopeptide permease, a binding protein-dependent transport system. This APP system can completely substitute for the OPP system in both sporulation and genetic competence. AppA can bind and transport tetra- and pentapep

COG id: COG0747

COG function: function code E; ABC-type dipeptide transport system, periplasmic component

Gene ontology:

Cell location: Cell membrane; Lipid-anchor (Probable) [H]

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the bacterial solute-binding protein 5 family [H]

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR000914 [H]

Pfam domain/function: PF00496 SBP_bac_5 [H]

EC number: NA

Molecular weight: Translated: 64689; Mature: 64689

Theoretical pI: Translated: 8.52; Mature: 8.52

Prosite motif: PS00013 PROKAR_LIPOPROTEIN

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.5 %Cys     (Translated Protein)
2.8 %Met     (Translated Protein)
3.3 %Cys+Met (Translated Protein)
0.5 %Cys     (Mature Protein)
2.8 %Met     (Mature Protein)
3.3 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MKRIKVLTVVLAITFMVAGCSNTKTKQSSSDSSLQSQSSIDAKYINLTMVTPKTINPITN
CCHHHHHHHHHHHHHHHHCCCCCCCCCCCCCHHHHHHHCCCEEEEEEEEECCCCCCCCCC
TDKSVGYIMNLVYDSLFTIDENYNVIPQLVKEYNIAQDGMSIDIKLKDAKWHDGKNVTSN
CCCHHHHHHHHHHHHHEEECCCCCHHHHHHHHCCCCCCCCEEEEEEECCCCCCCCCCCCC
DVNYTIGLIQKSADSPYNEFTKNIASVNIKSDKDFTIKFKARYAFSIDSLIFPIVSQNHL
CCEEEEEEEECCCCCCHHHHHHHHHEEEECCCCCEEEEEEEEEEEEHHHHHHHHHCCCCC
DSKDVNDKNNNMIGNGKYKIESYTEREGMVLSVNKDYYEEVPKTMKNIKVGMVPNEDART
CCCCCCCCCCCEECCCEEEEEEECCCCCEEEEECHHHHHHHHHHHHHCEEECCCCCCCCC
SMVMALDSDITNVTLNDLSKFQEKEFNITKYQGRDYECVLFNYNNPFFKDVNFRKAIAHS
EEEEEECCCCCEEEHHHHHHHHHHCCCEEEECCCCEEEEEEECCCCCCCCCCHHHHHHHH
IDKDRIISEGYMDDATPVNFPLNSKSKYYNSEMKDLEFNKDKAIECLAKVEYANVNSVNQ
CCHHHHHHCCCCCCCCCCCCCCCCCCHHCCCCHHCCCCCCHHHHHHHHHHHCCCCCCCCC
NDNKVKNQKKSAKKNSKKLTPEEEAKAKKAEEDRIKKEAEEKKNREKEEVKKSLSEMNLK
CCHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHCCEE
IIVNRDNSERIKTANIINENLKAIGINSTVNQLSDKDMENALNSKNYDLALVGWKLSIIP
EEEECCCCCHHHHHHHHHCCCEEEECCHHHHHHHHHHHHHHHCCCCCEEEEEEEEEEECC
DASSIIASSGYTDDKLNGYMSALTSSTSEIETKKAYKDVQTYIKDNATFISLAVRNNYIV
CHHHHHHCCCCCCHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHCCCCEEEEEEEECCEEE
SNSRLKGKITPNDFDVYEGISNLDIKSNESN
ECCCEEEEECCCCCHHHCCCCCCCCCCCCCC
>Mature Secondary Structure
MKRIKVLTVVLAITFMVAGCSNTKTKQSSSDSSLQSQSSIDAKYINLTMVTPKTINPITN
CCHHHHHHHHHHHHHHHHCCCCCCCCCCCCCHHHHHHHCCCEEEEEEEEECCCCCCCCCC
TDKSVGYIMNLVYDSLFTIDENYNVIPQLVKEYNIAQDGMSIDIKLKDAKWHDGKNVTSN
CCCHHHHHHHHHHHHHEEECCCCCHHHHHHHHCCCCCCCCEEEEEEECCCCCCCCCCCCC
DVNYTIGLIQKSADSPYNEFTKNIASVNIKSDKDFTIKFKARYAFSIDSLIFPIVSQNHL
CCEEEEEEEECCCCCCHHHHHHHHHEEEECCCCCEEEEEEEEEEEEHHHHHHHHHCCCCC
DSKDVNDKNNNMIGNGKYKIESYTEREGMVLSVNKDYYEEVPKTMKNIKVGMVPNEDART
CCCCCCCCCCCEECCCEEEEEEECCCCCEEEEECHHHHHHHHHHHHHCEEECCCCCCCCC
SMVMALDSDITNVTLNDLSKFQEKEFNITKYQGRDYECVLFNYNNPFFKDVNFRKAIAHS
EEEEEECCCCCEEEHHHHHHHHHHCCCEEEECCCCEEEEEEECCCCCCCCCCHHHHHHHH
IDKDRIISEGYMDDATPVNFPLNSKSKYYNSEMKDLEFNKDKAIECLAKVEYANVNSVNQ
CCHHHHHHCCCCCCCCCCCCCCCCCCHHCCCCHHCCCCCCHHHHHHHHHHHCCCCCCCCC
NDNKVKNQKKSAKKNSKKLTPEEEAKAKKAEEDRIKKEAEEKKNREKEEVKKSLSEMNLK
CCHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHCCEE
IIVNRDNSERIKTANIINENLKAIGINSTVNQLSDKDMENALNSKNYDLALVGWKLSIIP
EEEECCCCCHHHHHHHHHCCCEEEECCHHHHHHHHHHHHHHHCCCCCEEEEEEEEEEECC
DASSIIASSGYTDDKLNGYMSALTSSTSEIETKKAYKDVQTYIKDNATFISLAVRNNYIV
CHHHHHHCCCCCCHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHCCCCEEEEEEEECCEEE
SNSRLKGKITPNDFDVYEGISNLDIKSNESN
ECCCEEEEECCCCCHHHCCCCCCCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 7997159; 9384377 [H]