Definition Chlamydophila pneumoniae J138, complete genome.
Accession NC_002491
Length 1,226,565

Click here to switch to the map view.

The map label for this gene is yojL

Identifier: 15835871

GI number: 15835871

Start: 380272

End: 381216

Strand: Direct

Name: yojL

Synonym: CPj0336

Alternate gene names: 15835871

Gene position: 380272-381216 (Clockwise)

Preceding gene: 15835870

Following gene: 15835873

Centisome position: 31.0

GC content: 40.63

Gene sequence:

>945_bases
ATGGCGATGTTACCAAAATTTTTCTTAGTTCTTTTATGTCTTGGACTCTGTTCATGCTCTCAAAAAACGACAACAATCGA
AGGAGAGCAGATGACAATCTTCTATCGCATTGTTCTGGGAACCTCTTTATCCGCAAAAGAAAAAGCATCTTTATCCCAAC
AAATTGATAGATGCTTTCATAAGATCGACTCGATTTATAACAACTGGAATCCCTATTCTGAACTCTCGATAATCAACCGA
GCTCCAGCAGATGTCCCCATAACTTTATCTGTAGAACTTTCCGAGTTTCTAGATCAGGTAGATACACTTTACAAACTTTC
AGAAGGACGTTTTGACCCTACTGTAGGACCTTTAAAAACCCTATGGCTTCTACATCTCAAAAGTCAAACCCTCCCCCCTA
AAGACGTTTGGGAACAACATTATAAAGACATGGGCTGGCAACACTTGGAGTTTCAGTCAAACACAAAAACTCTAATCAAA
AAGAATCCTCATGTTCAAATCGACCTCTGTGGTGTTGTCAAAGGTTATGCCGTAGATTGTCTAAATGAAATTTGCAATAC
CTTTTGTCCGAACAACTATGTAGAGTGGGGAGGAGAGATCAAAACGTCAGGGCATCATCCCTCGGGAAGACCTTGGCGTA
TTTTTTCTGAAGCAGCAGGTACGATCTTAGATATCGATGATATGGCAATTGCAACAAGTGGAAATCATATTCAAAAATGG
TGTGTTGAAGGAAAAATTTACACCCATATTCTTGATACTCGTACAGGGAAACCCCTAGAGCTAAGCTCCTATCCTATCCA
AAGTGTTTCAGTAGTCCATCCGAGCTGCGCATACGCCGACGCTATTGCCACAGTCCTCATGACTTTTGATTCTAAAATAG
AAGCAAAACAGTGGGCTGAAGAACACCATATCCTAACCTATATCAATGATGGCGCCTCTTCATAG

Upstream 100 bases:

>100_bases
GAGATGTAGATTTTAATAACGTTGTGACAAAATGCGCAGCAATCACTCCAGTTCCTGGAGGCGTTGGTCCCATGACTGTC
GCTATGCTCATGAGCAATAC

Downstream 100 bases:

>100_bases
CAGCGGCAACTTCACGTTCCTTTTCTCTTTCTATGATCGTACGACGCTTATCATAAGCTTTTTTCCCACGACAACAACCC
AAACGTACCTTAACATAGCC

Product: hypothetical protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 314; Mature: 313

Protein sequence:

>314_residues
MAMLPKFFLVLLCLGLCSCSQKTTTIEGEQMTIFYRIVLGTSLSAKEKASLSQQIDRCFHKIDSIYNNWNPYSELSIINR
APADVPITLSVELSEFLDQVDTLYKLSEGRFDPTVGPLKTLWLLHLKSQTLPPKDVWEQHYKDMGWQHLEFQSNTKTLIK
KNPHVQIDLCGVVKGYAVDCLNEICNTFCPNNYVEWGGEIKTSGHHPSGRPWRIFSEAAGTILDIDDMAIATSGNHIQKW
CVEGKIYTHILDTRTGKPLELSSYPIQSVSVVHPSCAYADAIATVLMTFDSKIEAKQWAEEHHILTYINDGASS

Sequences:

>Translated_314_residues
MAMLPKFFLVLLCLGLCSCSQKTTTIEGEQMTIFYRIVLGTSLSAKEKASLSQQIDRCFHKIDSIYNNWNPYSELSIINR
APADVPITLSVELSEFLDQVDTLYKLSEGRFDPTVGPLKTLWLLHLKSQTLPPKDVWEQHYKDMGWQHLEFQSNTKTLIK
KNPHVQIDLCGVVKGYAVDCLNEICNTFCPNNYVEWGGEIKTSGHHPSGRPWRIFSEAAGTILDIDDMAIATSGNHIQKW
CVEGKIYTHILDTRTGKPLELSSYPIQSVSVVHPSCAYADAIATVLMTFDSKIEAKQWAEEHHILTYINDGASS
>Mature_313_residues
AMLPKFFLVLLCLGLCSCSQKTTTIEGEQMTIFYRIVLGTSLSAKEKASLSQQIDRCFHKIDSIYNNWNPYSELSIINRA
PADVPITLSVELSEFLDQVDTLYKLSEGRFDPTVGPLKTLWLLHLKSQTLPPKDVWEQHYKDMGWQHLEFQSNTKTLIKK
NPHVQIDLCGVVKGYAVDCLNEICNTFCPNNYVEWGGEIKTSGHHPSGRPWRIFSEAAGTILDIDDMAIATSGNHIQKWC
VEGKIYTHILDTRTGKPLELSSYPIQSVSVVHPSCAYADAIATVLMTFDSKIEAKQWAEEHHILTYINDGASS

Specific function: Involved in the conversion of aminoimidazole ribotide (AIR), a purine intermediate, to the 4-amino-5-hydroxymethyl-2- methyl pyrimidine (HMP) moiety of thiamine

COG id: COG1477

COG function: function code H; Membrane-associated lipoprotein involved in thiamine biosynthesis

Gene ontology:

Cell location: Cell membrane; Lipid-anchor (Potential)

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the ApbE family

Homologues:

Organism=Escherichia coli, GI1788543, Length=325, Percent_Identity=26.7692307692308, Blast_Score=112, Evalue=2e-26,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): APBE_CHLPN (Q9Z8K2)

Other databases:

- EMBL:   AE001363
- EMBL:   AE002161
- EMBL:   BA000008
- EMBL:   AE009440
- PIR:   F72090
- PIR:   H86532
- RefSeq:   NP_224541.1
- RefSeq:   NP_300395.1
- RefSeq:   NP_444970.1
- RefSeq:   NP_876621.1
- ProteinModelPortal:   Q9Z8K2
- SMR:   Q9Z8K2
- GeneID:   1467028
- GeneID:   894910
- GeneID:   919110
- GeneID:   963055
- GenomeReviews:   AE001363_GR
- GenomeReviews:   AE002161_GR
- GenomeReviews:   AE009440_GR
- GenomeReviews:   BA000008_GR
- KEGG:   cpa:CP0422
- KEGG:   cpn:CPn0336
- KEGG:   cpt:CpB0346
- TIGR:   CP_0422
- HOGENOM:   HBG413937
- OMA:   LANAWGF
- PhylomeDB:   Q9Z8K2
- ProtClustDB:   CLSK871169
- BioCyc:   CPNE115711:CP_0422-MONOMER
- BioCyc:   CPNE115713:CPN0336-MONOMER
- BioCyc:   CPNE138677:CPJ0336-MONOMER
- BioCyc:   CPNE182082:CPB0346-MONOMER
- InterPro:   IPR003374

Pfam domain/function: PF02424 ApbE

EC number: NA

Molecular weight: Translated: 35357; Mature: 35226

Theoretical pI: Translated: 6.22; Mature: 6.22

Prosite motif: PS51257 PROKAR_LIPOPROTEIN; PS00013 PROKAR_LIPOPROTEIN

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

3.2 %Cys     (Translated Protein)
1.9 %Met     (Translated Protein)
5.1 %Cys+Met (Translated Protein)
3.2 %Cys     (Mature Protein)
1.6 %Met     (Mature Protein)
4.8 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MAMLPKFFLVLLCLGLCSCSQKTTTIEGEQMTIFYRIVLGTSLSAKEKASLSQQIDRCFH
CCCCHHHHHHHHHHHHHCCCCCCEEECCCEEEEEEEEECCCCCCHHHHHHHHHHHHHHHH
KIDSIYNNWNPYSELSIINRAPADVPITLSVELSEFLDQVDTLYKLSEGRFDPTVGPLKT
HHHHHHCCCCCHHHHHHHHCCCCCCEEEEEEHHHHHHHHHHHHHHHHCCCCCCCCHHHHH
LWLLHLKSQTLPPKDVWEQHYKDMGWQHLEFQSNTKTLIKKNPHVQIDLCGVVKGYAVDC
HHHHHHHCCCCCHHHHHHHHHHHCCCEEEEECCCCHHHHCCCCCEEEEEECHHHHHHHHH
LNEICNTFCPNNYVEWGGEIKTSGHHPSGRPWRIFSEAAGTILDIDDMAIATSGNHIQKW
HHHHHHHHCCCCHHHCCCEEEECCCCCCCCCEEEEHHCCCCEEECCCEEEECCCCHHHHH
CVEGKIYTHILDTRTGKPLELSSYPIQSVSVVHPSCAYADAIATVLMTFDSKIEAKQWAE
HHCCEEEEEEEECCCCCCEEECCCCCCEEEEECCCHHHHHHHHHHHHHHCCCHHHHHHHH
EHHILTYINDGASS
HCCEEEEECCCCCC
>Mature Secondary Structure 
AMLPKFFLVLLCLGLCSCSQKTTTIEGEQMTIFYRIVLGTSLSAKEKASLSQQIDRCFH
CCCHHHHHHHHHHHHHCCCCCCEEECCCEEEEEEEEECCCCCCHHHHHHHHHHHHHHHH
KIDSIYNNWNPYSELSIINRAPADVPITLSVELSEFLDQVDTLYKLSEGRFDPTVGPLKT
HHHHHHCCCCCHHHHHHHHCCCCCCEEEEEEHHHHHHHHHHHHHHHHCCCCCCCCHHHHH
LWLLHLKSQTLPPKDVWEQHYKDMGWQHLEFQSNTKTLIKKNPHVQIDLCGVVKGYAVDC
HHHHHHHCCCCCHHHHHHHHHHHCCCEEEEECCCCHHHHCCCCCEEEEEECHHHHHHHHH
LNEICNTFCPNNYVEWGGEIKTSGHHPSGRPWRIFSEAAGTILDIDDMAIATSGNHIQKW
HHHHHHHHCCCCHHHCCCEEEECCCCCCCCCEEEEHHCCCCEEECCCEEEECCCCHHHHH
CVEGKIYTHILDTRTGKPLELSSYPIQSVSVVHPSCAYADAIATVLMTFDSKIEAKQWAE
HHCCEEEEEEEECCCCCCEEECCCCCCEEEEECCCHHHHHHHHHHHHHHCCCHHHHHHHH
EHHILTYINDGASS
HCCEEEEECCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 7.0

TargetDB status: NA

Availability: NA

References: 10192388; 10684935; 10871362