Definition Candidatus Blochmannia pennsylvanicus str. BPEN, complete genome.
Accession NC_007292
Length 791,654

Click here to switch to the map view.

The map label for this gene is yidCD [H]

Identifier: 71891805

GI number: 71891805

Start: 12400

End: 14316

Strand: Reverse

Name: yidCD [H]

Synonym: BPEN_012

Alternate gene names: 71891805

Gene position: 14316-12400 (Counterclockwise)

Preceding gene: 71891806

Following gene: 71891804

Centisome position: 1.81

GC content: 28.79

Gene sequence:

>1917_bases
ATGGTATCACCATTTGTGTTAATAGAAAAAAGCATAATATGGCTGATATATGGATACCAAGTCAGTGTCAGTCCTATATT
GGGCCATCATTGTCGTTTTCAAAAAACATGTTCTCAATATGGGGTGGAATCAATACATAAATTCGGGGTGTTACGAGGTA
TCTGGATGACATGTATTCGTATATTGCAATGCCATCCTTTAACTTTAAATAACAATGAAGATTTTAAATATTATTCACAT
TCACATATTCAGGACATAATCAACATGGATTCGCAACGTAATTTCTTTGTGATAGCTTTTTTAATTATGTCGTTTATACT
ATGGCAGATATGGCAAACAGAATATCATCAGAGAACTAATATTCAAAAAATAAATATACATGAAAATACATATCCATTAA
TTCGTTCTGAAGATAATGATGCAATAAAATATGTACATCATACAAATCATGTGATTACAGTAAAAACAGATGTGTTGTTA
CTCAAAATAAATACTTATGGGGGAGATATTGAAGAGGCATATCTCGTGAATTATTTAGAGAATTTACATTCTAAAGAACC
TTTTCATCTCTTAAGTACATCACAAGCATTTACATATCAAACAAACAGCGGGCTAATAACTGAAAACATACCGGGCCGGT
CATATAATAAAAAATTTATATACACTACCGCAACTGATAAAAGTTTATATATCATACCAAAAAATGAAAATAAATTACAA
TTAACTTTAACGCATTACGCTTCCGATGGGATTACATATACTAAGAATTATATTTTTCATAGAAATGATTACTCTATATA
TGTATTCTATACCGTAAATAATATGAGCACTTATCCATTAAAAATTAAGTTATTTGGTAATATAGTACAATCCGAACATT
ATCCCAAATCACATAATAACAGCGATAACGGAGATAATTTTCCTTTATACTCCTATCGAGGATCAGCATACTCTACTGAT
AAAAAAAAATATCAAAAATACAGCTTTAAAGATATAAAAAATATGAATTTAAAAATTAATACTTCTAAAGGTTGGATAGC
AATGTCACAAAAATATTTTGCGACAGCTTGGATTCCCCTTACTCAAGGGAATAATACATTTTATACTACCTACCATAACA
ATAATAGCGCTTCTATAGGTTTTCAATCTAATTCAATAGATCTCCCGATAGGAGAAACAGGTACATTCCAATCTATATTA
TGGATAGGTCCAAAAATTCAAGAAAAAATGAAAGCAATAGCTCCAAATTTAGATCTATTAGTTGACTACGGATGGTTATG
GTTTATTTCTCAACCATTGTTTAAATTATTGAGCTTTATTTACAGTTACATAGAAAATTGGGGAATATCTATTATTATAA
TAACATTAATTATACGTCTAATCATGTATCCTTTAACTAAAGCACAATATACTTCTATGGCAAAAATACGTATGCTACAA
CCTAAATTGTCTATAATACAAGAAGAATATAAACATGATAAGTATCAATACCATCAAAAAACTATAGAATTATATAAGTT
AGAAAAAGTGAATCCATTGGGGGGATGCTTACCTTTATTAATCCAAATGCCAATATTCTTAGCTTTATATTATATGTTAT
CAGGTTCTGTAGAATTAAGGCACGCTGCATTTGCTTTCTGGATTCATGATTTATCTGCTCAGGATCCTTATTACATATTA
CCGATATTAATGGGAATTACTATGTTTTTTATACAAAAAATGTCGCCGACTACAATTACTGATGCGATACAGAAAAAAAT
GATGACTATCATGTTAATCATTTTTACTATATTTTTTTTATGGTTCCCATCTGGTTTAGTATTATATTATATAGCAAGCA
ATATCATCACCATTATTCAACAATACATGATTTATCAAGAACTAGAAAAACGAGGATTATACAATAAAAATAACTAA

Upstream 100 bases:

>100_bases
GTCAACATAACTTATTAGCTAAAGACTTTGTTCTAACTATTCGCTCAAAAGAGATTATTTATTACAAAAATAAAACATTG
ATACAAGAACTCGAAAAATT

Downstream 100 bases:

>100_bases
TAAAAATATTCAAAAAAATTTATAACTCAAGTATATCTTCGCATTATAATATGTTTTAAAGTATAATAAAAATTATGAAC
TATACAATAGATACAGTGGT

Product: hypothetical protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 638; Mature: 638

Protein sequence:

>638_residues
MVSPFVLIEKSIIWLIYGYQVSVSPILGHHCRFQKTCSQYGVESIHKFGVLRGIWMTCIRILQCHPLTLNNNEDFKYYSH
SHIQDIINMDSQRNFFVIAFLIMSFILWQIWQTEYHQRTNIQKINIHENTYPLIRSEDNDAIKYVHHTNHVITVKTDVLL
LKINTYGGDIEEAYLVNYLENLHSKEPFHLLSTSQAFTYQTNSGLITENIPGRSYNKKFIYTTATDKSLYIIPKNENKLQ
LTLTHYASDGITYTKNYIFHRNDYSIYVFYTVNNMSTYPLKIKLFGNIVQSEHYPKSHNNSDNGDNFPLYSYRGSAYSTD
KKKYQKYSFKDIKNMNLKINTSKGWIAMSQKYFATAWIPLTQGNNTFYTTYHNNNSASIGFQSNSIDLPIGETGTFQSIL
WIGPKIQEKMKAIAPNLDLLVDYGWLWFISQPLFKLLSFIYSYIENWGISIIIITLIIRLIMYPLTKAQYTSMAKIRMLQ
PKLSIIQEEYKHDKYQYHQKTIELYKLEKVNPLGGCLPLLIQMPIFLALYYMLSGSVELRHAAFAFWIHDLSAQDPYYIL
PILMGITMFFIQKMSPTTITDAIQKKMMTIMLIIFTIFFLWFPSGLVLYYIASNIITIIQQYMIYQELEKRGLYNKNN

Sequences:

>Translated_638_residues
MVSPFVLIEKSIIWLIYGYQVSVSPILGHHCRFQKTCSQYGVESIHKFGVLRGIWMTCIRILQCHPLTLNNNEDFKYYSH
SHIQDIINMDSQRNFFVIAFLIMSFILWQIWQTEYHQRTNIQKINIHENTYPLIRSEDNDAIKYVHHTNHVITVKTDVLL
LKINTYGGDIEEAYLVNYLENLHSKEPFHLLSTSQAFTYQTNSGLITENIPGRSYNKKFIYTTATDKSLYIIPKNENKLQ
LTLTHYASDGITYTKNYIFHRNDYSIYVFYTVNNMSTYPLKIKLFGNIVQSEHYPKSHNNSDNGDNFPLYSYRGSAYSTD
KKKYQKYSFKDIKNMNLKINTSKGWIAMSQKYFATAWIPLTQGNNTFYTTYHNNNSASIGFQSNSIDLPIGETGTFQSIL
WIGPKIQEKMKAIAPNLDLLVDYGWLWFISQPLFKLLSFIYSYIENWGISIIIITLIIRLIMYPLTKAQYTSMAKIRMLQ
PKLSIIQEEYKHDKYQYHQKTIELYKLEKVNPLGGCLPLLIQMPIFLALYYMLSGSVELRHAAFAFWIHDLSAQDPYYIL
PILMGITMFFIQKMSPTTITDAIQKKMMTIMLIIFTIFFLWFPSGLVLYYIASNIITIIQQYMIYQELEKRGLYNKNN
>Mature_638_residues
MVSPFVLIEKSIIWLIYGYQVSVSPILGHHCRFQKTCSQYGVESIHKFGVLRGIWMTCIRILQCHPLTLNNNEDFKYYSH
SHIQDIINMDSQRNFFVIAFLIMSFILWQIWQTEYHQRTNIQKINIHENTYPLIRSEDNDAIKYVHHTNHVITVKTDVLL
LKINTYGGDIEEAYLVNYLENLHSKEPFHLLSTSQAFTYQTNSGLITENIPGRSYNKKFIYTTATDKSLYIIPKNENKLQ
LTLTHYASDGITYTKNYIFHRNDYSIYVFYTVNNMSTYPLKIKLFGNIVQSEHYPKSHNNSDNGDNFPLYSYRGSAYSTD
KKKYQKYSFKDIKNMNLKINTSKGWIAMSQKYFATAWIPLTQGNNTFYTTYHNNNSASIGFQSNSIDLPIGETGTFQSIL
WIGPKIQEKMKAIAPNLDLLVDYGWLWFISQPLFKLLSFIYSYIENWGISIIIITLIIRLIMYPLTKAQYTSMAKIRMLQ
PKLSIIQEEYKHDKYQYHQKTIELYKLEKVNPLGGCLPLLIQMPIFLALYYMLSGSVELRHAAFAFWIHDLSAQDPYYIL
PILMGITMFFIQKMSPTTITDAIQKKMMTIMLIIFTIFFLWFPSGLVLYYIASNIITIIQQYMIYQELEKRGLYNKNN

Specific function: Required for the insertion of integral membrane proteins into the membrane. Probably plays an essential role in the integration of proteins of the respiratory chain complexes. Involved in integration of membrane proteins that insert dependently and indepe

COG id: COG0706

COG function: function code U; Preprotein translocase subunit YidC

Gene ontology:

Cell location: Cell inner membrane; Multi-pass membrane protein [H]

Metaboloic importance: Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Belongs to the OXA1/oxaA family. Type 1 subfamily [H]

Homologues:

Organism=Escherichia coli, GI1790140, Length=550, Percent_Identity=54.3636363636364, Blast_Score=601, Evalue=1e-173,
Organism=Escherichia coli, GI87082322, Length=67, Percent_Identity=49.2537313432836, Blast_Score=82, Evalue=1e-16,
Organism=Drosophila melanogaster, GI24662345, Length=195, Percent_Identity=27.6923076923077, Blast_Score=70, Evalue=5e-12,
Organism=Drosophila melanogaster, GI21356443, Length=195, Percent_Identity=27.6923076923077, Blast_Score=70, Evalue=5e-12,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR019998
- InterPro:   IPR001708 [H]

Pfam domain/function: PF02096 60KD_IMP [H]

EC number: NA

Molecular weight: Translated: 74821; Mature: 74821

Theoretical pI: Translated: 9.29; Mature: 9.29

Prosite motif: PS00496 PII_GLNB_UMP

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.8 %Cys     (Translated Protein)
3.1 %Met     (Translated Protein)
3.9 %Cys+Met (Translated Protein)
0.8 %Cys     (Mature Protein)
3.1 %Met     (Mature Protein)
3.9 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MVSPFVLIEKSIIWLIYGYQVSVSPILGHHCRFQKTCSQYGVESIHKFGVLRGIWMTCIR
CCCCEEEEECCEEEEEEEEEEEECHHHCCCHHHHHHHHHHCHHHHHHHHHHHHHHHHHHH
ILQCHPLTLNNNEDFKYYSHSHIQDIINMDSQRNFFVIAFLIMSFILWQIWQTEYHQRTN
HHHCCCEEECCCCCCEEECHHHHHHHHCCCCCCCEEHHHHHHHHHHHHHHHHHHHHHCCC
IQKINIHENTYPLIRSEDNDAIKYVHHTNHVITVKTDVLLLKINTYGGDIEEAYLVNYLE
CEEEEECCCCCCCEECCCCCEEEEEEECCEEEEEEEEEEEEEEECCCCCHHHHHHHHHHH
NLHSKEPFHLLSTSQAFTYQTNSGLITENIPGRSYNKKFIYTTATDKSLYIIPKNENKLQ
HHCCCCCEEEEECCCEEEEECCCCEEEECCCCCCCCCEEEEEEECCCEEEEEECCCCEEE
LTLTHYASDGITYTKNYIFHRNDYSIYVFYTVNNMSTYPLKIKLFGNIVQSEHYPKSHNN
EEEEEECCCCEEEEEEEEEEECCEEEEEEEEECCCCCCEEEEEEEHHHHHCCCCCCCCCC
SDNGDNFPLYSYRGSAYSTDKKKYQKYSFKDIKNMNLKINTSKGWIAMSQKYFATAWIPL
CCCCCCCCEEEECCCCCCCCHHHHHHCCHHHHCCCCEEEECCCCEEEECCCEEEEEEEEE
TQGNNTFYTTYHNNNSASIGFQSNSIDLPIGETGTFQSILWIGPKIQEKMKAIAPNLDLL
ECCCCEEEEEEECCCCEEEEECCCCEECCCCCCCCCCEEEEECCHHHHHHHHHCCCCEEE
VDYGWLWFISQPLFKLLSFIYSYIENWGISIIIITLIIRLIMYPLTKAQYTSMAKIRMLQ
EECHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHCCHHHHHHHHHHHCCC
PKLSIIQEEYKHDKYQYHQKTIELYKLEKVNPLGGCLPLLIQMPIFLALYYMLSGSVELR
HHHHHHHHHHHHHHHHHHHHHHHEEEEECCCCCCHHHHHHHHHHHHHHHHHHHCCCEEEH
HAAFAFWIHDLSAQDPYYILPILMGITMFFIQKMSPTTITDAIQKKMMTIMLIIFTIFFL
HHHEEEEEECCCCCCCEEHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHH
WFPSGLVLYYIASNIITIIQQYMIYQELEKRGLYNKNN
HHCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCC
>Mature Secondary Structure
MVSPFVLIEKSIIWLIYGYQVSVSPILGHHCRFQKTCSQYGVESIHKFGVLRGIWMTCIR
CCCCEEEEECCEEEEEEEEEEEECHHHCCCHHHHHHHHHHCHHHHHHHHHHHHHHHHHHH
ILQCHPLTLNNNEDFKYYSHSHIQDIINMDSQRNFFVIAFLIMSFILWQIWQTEYHQRTN
HHHCCCEEECCCCCCEEECHHHHHHHHCCCCCCCEEHHHHHHHHHHHHHHHHHHHHHCCC
IQKINIHENTYPLIRSEDNDAIKYVHHTNHVITVKTDVLLLKINTYGGDIEEAYLVNYLE
CEEEEECCCCCCCEECCCCCEEEEEEECCEEEEEEEEEEEEEEECCCCCHHHHHHHHHHH
NLHSKEPFHLLSTSQAFTYQTNSGLITENIPGRSYNKKFIYTTATDKSLYIIPKNENKLQ
HHCCCCCEEEEECCCEEEEECCCCEEEECCCCCCCCCEEEEEEECCCEEEEEECCCCEEE
LTLTHYASDGITYTKNYIFHRNDYSIYVFYTVNNMSTYPLKIKLFGNIVQSEHYPKSHNN
EEEEEECCCCEEEEEEEEEEECCEEEEEEEEECCCCCCEEEEEEEHHHHHCCCCCCCCCC
SDNGDNFPLYSYRGSAYSTDKKKYQKYSFKDIKNMNLKINTSKGWIAMSQKYFATAWIPL
CCCCCCCCEEEECCCCCCCCHHHHHHCCHHHHCCCCEEEECCCCEEEECCCEEEEEEEEE
TQGNNTFYTTYHNNNSASIGFQSNSIDLPIGETGTFQSILWIGPKIQEKMKAIAPNLDLL
ECCCCEEEEEEECCCCEEEEECCCCEECCCCCCCCCCEEEEECCHHHHHHHHHCCCCEEE
VDYGWLWFISQPLFKLLSFIYSYIENWGISIIIITLIIRLIMYPLTKAQYTSMAKIRMLQ
EECHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHCCHHHHHHHHHHHCCC
PKLSIIQEEYKHDKYQYHQKTIELYKLEKVNPLGGCLPLLIQMPIFLALYYMLSGSVELR
HHHHHHHHHHHHHHHHHHHHHHHEEEEECCCCCCHHHHHHHHHHHHHHHHHHHCCCEEEH
HAAFAFWIHDLSAQDPYYILPILMGITMFFIQKMSPTTITDAIQKKMMTIMLIIFTIFFL
HHHEEEEEECCCCCCCEEHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHH
WFPSGLVLYYIASNIITIIQQYMIYQELEKRGLYNKNN
HHCHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 12886019 [H]