Definition Chlamydophila pneumoniae CWL029, complete genome.
Accession NC_000922
Length 1,230,230

Click here to switch to the map view.

The map label for this gene is Not Available

Identifier: 15618503

GI number: 15618503

Start: 681388

End: 682476

Strand: Reverse

Name: Not Available

Synonym: CPn0593

Alternate gene names: NA

Gene position: 682476-681388 (Counterclockwise)

Preceding gene: 15618507

Following gene: 15618500

Centisome position: 55.48

GC content: 42.06

Gene sequence:

>1089_bases
ATGGCTTTCAAAAGAAAAACTAGATGGCTGTGGCAAGTCTTGATCCTGAGTGTGGGATTGAATATGCTTTTTTTGCTCTT
ATTTTACTCTGCCATATTTCGTAAAGACATCTATAAGCTGCATTTATTTTCCGGACCTTTGATTGCGAAAAGTAGTCGTA
AGGTCTACCTTTCTGAAGATTTTTTAAACGAGATATCTCAAGCATCTTTGGACGACTTGATTTCGTTGTTCAAAGATGAG
CGCTATATGTATGGTCGGCCGATAAAACTTTGGGCGTTGAGTGTAGCGATAGCTTCCCACCACATAGACATCACTCCTGT
GCTTTCGAAGCCTTTGACCTATACAGAGTTGAAAGGATCTTCAGTGCGGTGGCTTTTGCCGAATATTGATCTTAAAGACT
TTCCTGTGATTTTGGACTATTTGCGTTGCCACAAGTATCCCTATACTTCTAAGGGCTTGTTTTTGCTGATAGAAAAGATG
GTACAAGAAGGCTGGGTAGATGAAGATTGCCTGTATCATTTCTGCTCGACTCCAGAATTTCTTTACTTGCGTACGTTACT
TGTAGGTGCAGACGTGCAGGCCTCTTCAGTAGCCTCATTAGCTCGTATGGTGATTCGTTGCGGATCCGAACGTTTCTTTC
ATTTTTGCAATGAAGAGAGCCGCACTTCCATGATTTCAGCTACACAACGTCAGAAAGTCTTAAAATCTTATTTAGATTGT
GAAGAATCTCTGGCAGCCTTGCTTTTGCTTGTCCATGATAGTGATGTTGTTTTGCATGAATTTTGTGATGAAGATCTTGA
GAAGGTCATCCGCCTGATGCCTCAAGAGTCTCCCTATAGTCAGAATTTCTTCTCTCGATTACAGCATTCTCCGCGTAGAG
AGTTGGCCTGCATGTCGACTCAGAGGGTAGAGGCTCCTCGTGTTCAAGAAGATCAGGATGAAGAGTATGTGGTACAGGAC
GGGGATTCTTTATGGTTGATAGCTAAGAGGTTTGGCATTCCTATGGATAAGATCATTCAGAAAAATGGCTTGAATCACCA
CCGTCTATTTCCTGGTAAGGTTCTAAAACTTCCTGCAAAGCAGTCTTAG

Upstream 100 bases:

>100_bases
TAAACGCAAGGATGTTTTTACGAGGGATTTTACGATGACCTGTGTATAGTGGCAAGTGTTTTAATCCTAGAGAATGAACT
GAGTTTTAGGCGCAAAATGT

Downstream 100 bases:

>100_bases
GGACCATGTCAATGCCTCCAGGATGCCAGGGGCCACACTTTCCGATTCTCTTTATAGAAAGCCAGCAGCCCATCAGGAAG
CCGTGAGATTTTAAGGCTTG

Product: hypothetical protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 362; Mature: 361

Protein sequence:

>362_residues
MAFKRKTRWLWQVLILSVGLNMLFLLLFYSAIFRKDIYKLHLFSGPLIAKSSRKVYLSEDFLNEISQASLDDLISLFKDE
RYMYGRPIKLWALSVAIASHHIDITPVLSKPLTYTELKGSSVRWLLPNIDLKDFPVILDYLRCHKYPYTSKGLFLLIEKM
VQEGWVDEDCLYHFCSTPEFLYLRTLLVGADVQASSVASLARMVIRCGSERFFHFCNEESRTSMISATQRQKVLKSYLDC
EESLAALLLLVHDSDVVLHEFCDEDLEKVIRLMPQESPYSQNFFSRLQHSPRRELACMSTQRVEAPRVQEDQDEEYVVQD
GDSLWLIAKRFGIPMDKIIQKNGLNHHRLFPGKVLKLPAKQS

Sequences:

>Translated_362_residues
MAFKRKTRWLWQVLILSVGLNMLFLLLFYSAIFRKDIYKLHLFSGPLIAKSSRKVYLSEDFLNEISQASLDDLISLFKDE
RYMYGRPIKLWALSVAIASHHIDITPVLSKPLTYTELKGSSVRWLLPNIDLKDFPVILDYLRCHKYPYTSKGLFLLIEKM
VQEGWVDEDCLYHFCSTPEFLYLRTLLVGADVQASSVASLARMVIRCGSERFFHFCNEESRTSMISATQRQKVLKSYLDC
EESLAALLLLVHDSDVVLHEFCDEDLEKVIRLMPQESPYSQNFFSRLQHSPRRELACMSTQRVEAPRVQEDQDEEYVVQD
GDSLWLIAKRFGIPMDKIIQKNGLNHHRLFPGKVLKLPAKQS
>Mature_361_residues
AFKRKTRWLWQVLILSVGLNMLFLLLFYSAIFRKDIYKLHLFSGPLIAKSSRKVYLSEDFLNEISQASLDDLISLFKDER
YMYGRPIKLWALSVAIASHHIDITPVLSKPLTYTELKGSSVRWLLPNIDLKDFPVILDYLRCHKYPYTSKGLFLLIEKMV
QEGWVDEDCLYHFCSTPEFLYLRTLLVGADVQASSVASLARMVIRCGSERFFHFCNEESRTSMISATQRQKVLKSYLDCE
ESLAALLLLVHDSDVVLHEFCDEDLEKVIRLMPQESPYSQNFFSRLQHSPRRELACMSTQRVEAPRVQEDQDEEYVVQDG
DSLWLIAKRFGIPMDKIIQKNGLNHHRLFPGKVLKLPAKQS

Specific function: Unknown

COG id: NA

COG function: NA

Gene ontology:

Cell location: Membrane; Single-pass membrane protein (Potential)

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Contains 1 LysM repeat

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): Y593_CHLPN (Q9Z7W1)

Other databases:

- EMBL:   AE001363
- EMBL:   AE002161
- EMBL:   BA000008
- EMBL:   AE009440
- PIR:   A72061
- PIR:   D81606
- PIR:   F86564
- RefSeq:   NP_224789.1
- RefSeq:   NP_300649.1
- RefSeq:   NP_444707.1
- RefSeq:   NP_876889.1
- ProteinModelPortal:   Q9Z7W1
- SMR:   Q9Z7W1
- GeneID:   1467296
- GeneID:   895379
- GeneID:   919349
- GeneID:   963108
- GenomeReviews:   AE001363_GR
- GenomeReviews:   AE002161_GR
- GenomeReviews:   AE009440_GR
- GenomeReviews:   BA000008_GR
- KEGG:   cpa:CP0155
- KEGG:   cpj:CPj0593
- KEGG:   cpn:CPn0593
- KEGG:   cpt:CpB0616
- TIGR:   CP_0155
- HOGENOM:   HBG414089
- OMA:   SLARMVI
- ProtClustDB:   CLSK871406
- BioCyc:   CPNE115711:CP_0155-MONOMER
- BioCyc:   CPNE115713:CPN0593-MONOMER
- BioCyc:   CPNE138677:CPJ0593-MONOMER
- BioCyc:   CPNE182082:CPB0616-MONOMER
- InterPro:   IPR018392
- InterPro:   IPR002482
- SMART:   SM00257

Pfam domain/function: PF01476 LysM

EC number: NA

Molecular weight: Translated: 42054; Mature: 41923

Theoretical pI: Translated: 7.79; Mature: 7.79

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

HASH(0xc35623c)-;

Cys/Met content:

2.2 %Cys     (Translated Protein)
2.5 %Met     (Translated Protein)
4.7 %Cys+Met (Translated Protein)
2.2 %Cys     (Mature Protein)
2.2 %Met     (Mature Protein)
4.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MAFKRKTRWLWQVLILSVGLNMLFLLLFYSAIFRKDIYKLHLFSGPLIAKSSRKVYLSED
CCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHEEEEECCCEEECCCCEEEECHH
FLNEISQASLDDLISLFKDERYMYGRPIKLWALSVAIASHHIDITPVLSKPLTYTELKGS
HHHHHHHHHHHHHHHHHHCCCHHCCCCHHHHHHHHHHHHCCCCEEHHHCCCCEEEECCCC
SVRWLLPNIDLKDFPVILDYLRCHKYPYTSKGLFLLIEKMVQEGWVDEDCLYHFCSTPEF
CEEEEECCCCCCHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHCCCCHHHHHHHHCCCHH
LYLRTLLVGADVQASSVASLARMVIRCGSERFFHFCNEESRTSMISATQRQKVLKSYLDC
HHHHHHHHCCCCCHHHHHHHHHHHHHHCCHHHHHHHCCHHHHHHHHHHHHHHHHHHHHCH
EESLAALLLLVHDSDVVLHEFCDEDLEKVIRLMPQESPYSQNFFSRLQHSPRRELACMST
HHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHCCHHHHHHHHHH
QRVEAPRVQEDQDEEYVVQDGDSLWLIAKRFGIPMDKIIQKNGLNHHRLFPGKVLKLPAK
HHCCCCCCCCCCCCCEEEECCCCEEEEHHHHCCCHHHHHHHCCCCCCCCCCCHHEECCCC
QS
CH
>Mature Secondary Structure 
AFKRKTRWLWQVLILSVGLNMLFLLLFYSAIFRKDIYKLHLFSGPLIAKSSRKVYLSED
CCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHEEEEECCCEEECCCCEEEECHH
FLNEISQASLDDLISLFKDERYMYGRPIKLWALSVAIASHHIDITPVLSKPLTYTELKGS
HHHHHHHHHHHHHHHHHHCCCHHCCCCHHHHHHHHHHHHCCCCEEHHHCCCCEEEECCCC
SVRWLLPNIDLKDFPVILDYLRCHKYPYTSKGLFLLIEKMVQEGWVDEDCLYHFCSTPEF
CEEEEECCCCCCHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHCCCCHHHHHHHHCCCHH
LYLRTLLVGADVQASSVASLARMVIRCGSERFFHFCNEESRTSMISATQRQKVLKSYLDC
HHHHHHHHCCCCCHHHHHHHHHHHHHHCCHHHHHHHCCHHHHHHHHHHHHHHHHHHHHCH
EESLAALLLLVHDSDVVLHEFCDEDLEKVIRLMPQESPYSQNFFSRLQHSPRRELACMST
HHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHCCHHHHHHHHHH
QRVEAPRVQEDQDEEYVVQDGDSLWLIAKRFGIPMDKIIQKNGLNHHRLFPGKVLKLPAK
HHCCCCCCCCCCCCCEEEECCCCEEEEHHHHCCCHHHHHHHCCCCCCCCCCCHHEECCCC
QS
CH

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 10192388; 10684935; 10871362