Definition Candidatus Protochlamydia amoebophila UWE25, complete genome.
Accession NC_005861
Length 2,414,465

Click here to switch to the map view.

The map label for this gene is 46446522

Identifier: 46446522

GI number: 46446522

Start: 1072205

End: 1074166

Strand: Direct

Name: 46446522

Synonym: pc0888

Alternate gene names: NA

Gene position: 1072205-1074166 (Clockwise)

Preceding gene: 46446521

Following gene: 46446527

Centisome position: 44.41

GC content: 40.06

Gene sequence:

>1962_bases
TTGAATATTCCTACTCTAAGTTATAGTTATCTTGTCAATACAATGACCACTTCTGACTATCAATCTCAAGAAATTAGCGA
TCTTTCTAGAGATGAAGATATCCCCTTAGGCAATTCTTTGGCAAATATAGAAGAAACTAGTGCACCAACGATTCAAGTTC
ACGATTTTTCCTCTTCATCTGAAGAACTTCAACTAAGCTTTCAAGAGGGAACTTCTCTGACTATTTCTCATTCTCAGTTA
GCTATGTTAAGGGAAAAATCCCTTTATTTTAAAACTCTTTGGTCAGGAAATTTTCAAGAAACCCTTCAACATCCTCTGGC
TTTGACACAAAAGGAGTTTACGCATCTGCTTAATTGTGTCATGGATGCTAATTTTAAAGTTCCTTTGGAAGAGATCACTT
CTTCCATTCAACTAGCCGATTATTATGAACTAACAGAAGTGGTGAAAAATTTAGAAGAACAGCTGATTGAGGGATACCGA
ACACAGGAATTTGAACCATTTAGTTCCACTGAAGAGAGTTTAGTCGCATTAAAAGAACTTTTAAATTTTGCACATCGCTA
TCAATTAAGTACATTGAAGAACTATTTAGAATTGACCGTTGTGAGCGCCTTATTAAATCAGACCTCTCAACTGACGGAGT
TTGAAAAAATTATAAAGCACTTCTTAAATGAGATAGAAGCATTTAATTTTTCAGACAATGCTTATTTAACAGATGCCCAT
CTTTTAGCATTAAAAGATTGTAAAAATTTAAAAGTACTCCATTTAGAGAAATGTCAGGTTATTACGGACGATGGTTTGGC
GCATTTGACACCCTTAACGGCTTTGCAGCATTTAGAATTAAGCGATTGCAGGAAACTCACCGATGCAGGATTAGCTCATT
TGACACCCTTAACGGCTTTGCAGCATCTAAATCTAAGCTTTTGCGATAAACTCACCGATGCAGGATTAGCTCATTTGACA
CCCTTAACGGCTTTGCAGCATCTAAATCTAAGCAGGTGCTATTATAAACTCACCGATGCAGGATTAGCTCATTTGACACC
CTTAACGGCTTTGCAGCATCTAAATCTAAGCTTTTGCGATAAACTCACCGATGCAGGATTAGTCCATTTGAAACTCTTAA
CGGGTTTGCAGCATCTAGATCTAAGAGAATTCTGGGAACTTACCGGTGCAGGATTAGCGCATTTAACAACTTTAACCGCT
TTGCAGCATCTAGATCTGAGTGGATGCGATAAGCTCACTGACGTAGGATTAGCCCATTTAACACCCTTAACGACTTTGCA
GCATCTAGATCTGAAAAGGTGTCGTAATCTCACGAACGCTGGATTAGTCCATTTGAAACTCTTAACGGGTTTGCAGCATC
TAAATTTGAGCGAATGCTATCATCTCACCGATGCAGGATTAGCCCATTTGACACCCTTAACCGCTTTGCAGCATCTAGAT
CTAAGCCAATGCAGTAAACTCACTGACGATGGATTAGCCCATTTAACACCCTTGACGGCTTTGCAGCATCTAGATCTAAG
CCAATGCAGTAAACTCACTGACGATGGATTAGCCCATTTAACACCCTTGACGGCTTTGCAGCATTTAGTTCTGGCTAGGT
GCCGTAATCTCACGGACGCTGGATTAGCGCATTTGACACCCTTAGAGACTTTACAACATTTAAATTTGAGTGGAGGCTAT
AAGCTCACGGGTGCTGGATTAGCGCATTTGAGGCCCTTAGTGGCTTTACAGCATTTAGATTTGAGCTATTGTAATGGGCT
CACGGACGCTGGATTAGCGCATTTGACACCCTTAGTGGCTTTACAGCATTTAGATTTGAGCTATTGTGATGGGCTCACGG
ACGCTGGATTAACGCATTTGAGGCCCTTAGTGGCTTTACAGCATTTAGATTTGAGCTATTGTGATGGGCTCACGGACGCT
GGATTAGCGCATTTTAAATTCTTAGCAGCTATAATACACTAA

Upstream 100 bases:

>100_bases
CCAAAATTCAGATTACTATTGCAATGATTTTTAGCTATATGTAATTTTGTTAAAATATTTATAAATTAAAAAATTTATTT
CACTCATTTGGATGGTCATT

Downstream 100 bases:

>100_bases
GAAACTTTTTAAGCTTTACCGGGAAATGAACTAAAAGTTAAAAAAAAGCAGCTCGAAGGCGAGGATTTGGGAAAAGGCTT
GCGCAGATAAAAGCTTCACA

Product: hypothetical protein

Products: NA

Alternate protein names: None

Number of amino acids: Translated: 653; Mature: 653

Protein sequence:

>653_residues
MNIPTLSYSYLVNTMTTSDYQSQEISDLSRDEDIPLGNSLANIEETSAPTIQVHDFSSSSEELQLSFQEGTSLTISHSQL
AMLREKSLYFKTLWSGNFQETLQHPLALTQKEFTHLLNCVMDANFKVPLEEITSSIQLADYYELTEVVKNLEEQLIEGYR
TQEFEPFSSTEESLVALKELLNFAHRYQLSTLKNYLELTVVSALLNQTSQLTEFEKIIKHFLNEIEAFNFSDNAYLTDAH
LLALKDCKNLKVLHLEKCQVITDDGLAHLTPLTALQHLELSDCRKLTDAGLAHLTPLTALQHLNLSFCDKLTDAGLAHLT
PLTALQHLNLSRCYYKLTDAGLAHLTPLTALQHLNLSFCDKLTDAGLVHLKLLTGLQHLDLREFWELTGAGLAHLTTLTA
LQHLDLSGCDKLTDVGLAHLTPLTTLQHLDLKRCRNLTNAGLVHLKLLTGLQHLNLSECYHLTDAGLAHLTPLTALQHLD
LSQCSKLTDDGLAHLTPLTALQHLDLSQCSKLTDDGLAHLTPLTALQHLVLARCRNLTDAGLAHLTPLETLQHLNLSGGY
KLTGAGLAHLRPLVALQHLDLSYCNGLTDAGLAHLTPLVALQHLDLSYCDGLTDAGLTHLRPLVALQHLDLSYCDGLTDA
GLAHFKFLAAIIH

Sequences:

>Translated_653_residues
MNIPTLSYSYLVNTMTTSDYQSQEISDLSRDEDIPLGNSLANIEETSAPTIQVHDFSSSSEELQLSFQEGTSLTISHSQL
AMLREKSLYFKTLWSGNFQETLQHPLALTQKEFTHLLNCVMDANFKVPLEEITSSIQLADYYELTEVVKNLEEQLIEGYR
TQEFEPFSSTEESLVALKELLNFAHRYQLSTLKNYLELTVVSALLNQTSQLTEFEKIIKHFLNEIEAFNFSDNAYLTDAH
LLALKDCKNLKVLHLEKCQVITDDGLAHLTPLTALQHLELSDCRKLTDAGLAHLTPLTALQHLNLSFCDKLTDAGLAHLT
PLTALQHLNLSRCYYKLTDAGLAHLTPLTALQHLNLSFCDKLTDAGLVHLKLLTGLQHLDLREFWELTGAGLAHLTTLTA
LQHLDLSGCDKLTDVGLAHLTPLTTLQHLDLKRCRNLTNAGLVHLKLLTGLQHLNLSECYHLTDAGLAHLTPLTALQHLD
LSQCSKLTDDGLAHLTPLTALQHLDLSQCSKLTDDGLAHLTPLTALQHLVLARCRNLTDAGLAHLTPLETLQHLNLSGGY
KLTGAGLAHLRPLVALQHLDLSYCNGLTDAGLAHLTPLVALQHLDLSYCDGLTDAGLTHLRPLVALQHLDLSYCDGLTDA
GLAHFKFLAAIIH
>Mature_653_residues
MNIPTLSYSYLVNTMTTSDYQSQEISDLSRDEDIPLGNSLANIEETSAPTIQVHDFSSSSEELQLSFQEGTSLTISHSQL
AMLREKSLYFKTLWSGNFQETLQHPLALTQKEFTHLLNCVMDANFKVPLEEITSSIQLADYYELTEVVKNLEEQLIEGYR
TQEFEPFSSTEESLVALKELLNFAHRYQLSTLKNYLELTVVSALLNQTSQLTEFEKIIKHFLNEIEAFNFSDNAYLTDAH
LLALKDCKNLKVLHLEKCQVITDDGLAHLTPLTALQHLELSDCRKLTDAGLAHLTPLTALQHLNLSFCDKLTDAGLAHLT
PLTALQHLNLSRCYYKLTDAGLAHLTPLTALQHLNLSFCDKLTDAGLVHLKLLTGLQHLDLREFWELTGAGLAHLTTLTA
LQHLDLSGCDKLTDVGLAHLTPLTTLQHLDLKRCRNLTNAGLVHLKLLTGLQHLNLSECYHLTDAGLAHLTPLTALQHLD
LSQCSKLTDDGLAHLTPLTALQHLDLSQCSKLTDDGLAHLTPLTALQHLVLARCRNLTDAGLAHLTPLETLQHLNLSGGY
KLTGAGLAHLRPLVALQHLDLSYCNGLTDAGLAHLTPLVALQHLDLSYCDGLTDAGLTHLRPLVALQHLDLSYCDGLTDA
GLAHFKFLAAIIH

Specific function: Unknown

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

Organism=Homo sapiens, GI22748931, Length=342, Percent_Identity=32.7485380116959, Blast_Score=135, Evalue=9e-32,
Organism=Homo sapiens, GI284447308, Length=310, Percent_Identity=34.5161290322581, Blast_Score=120, Evalue=6e-27,
Organism=Homo sapiens, GI161333852, Length=467, Percent_Identity=25.4817987152034, Blast_Score=119, Evalue=1e-26,
Organism=Homo sapiens, GI161333854, Length=473, Percent_Identity=25.1585623678647, Blast_Score=104, Evalue=3e-22,
Organism=Homo sapiens, GI6912466, Length=296, Percent_Identity=29.7297297297297, Blast_Score=101, Evalue=2e-21,
Organism=Homo sapiens, GI27734755, Length=435, Percent_Identity=27.5862068965517, Blast_Score=99, Evalue=1e-20,
Organism=Homo sapiens, GI296531375, Length=258, Percent_Identity=32.1705426356589, Blast_Score=86, Evalue=1e-16,
Organism=Homo sapiens, GI289666746, Length=403, Percent_Identity=28.5359801488834, Blast_Score=84, Evalue=4e-16,
Organism=Homo sapiens, GI284447314, Length=295, Percent_Identity=29.8305084745763, Blast_Score=80, Evalue=4e-15,
Organism=Homo sapiens, GI16306588, Length=293, Percent_Identity=30.7167235494881, Blast_Score=77, Evalue=8e-14,
Organism=Caenorhabditis elegans, GI25151694, Length=333, Percent_Identity=27.9279279279279, Blast_Score=95, Evalue=1e-19,
Organism=Caenorhabditis elegans, GI25151696, Length=333, Percent_Identity=27.9279279279279, Blast_Score=94, Evalue=2e-19,
Organism=Saccharomyces cerevisiae, GI6322549, Length=408, Percent_Identity=28.921568627451, Blast_Score=94, Evalue=7e-20,
Organism=Drosophila melanogaster, GI17647819, Length=301, Percent_Identity=35.5481727574751, Blast_Score=135, Evalue=1e-31,
Organism=Drosophila melanogaster, GI24662818, Length=327, Percent_Identity=32.7217125382263, Blast_Score=101, Evalue=1e-21,
Organism=Drosophila melanogaster, GI161076545, Length=314, Percent_Identity=31.2101910828025, Blast_Score=93, Evalue=6e-19,
Organism=Drosophila melanogaster, GI24652783, Length=314, Percent_Identity=30.8917197452229, Blast_Score=92, Evalue=1e-18,
Organism=Drosophila melanogaster, GI161076547, Length=314, Percent_Identity=30.8917197452229, Blast_Score=92, Evalue=1e-18,
Organism=Drosophila melanogaster, GI161076549, Length=314, Percent_Identity=30.8917197452229, Blast_Score=92, Evalue=1e-18,
Organism=Drosophila melanogaster, GI21357913, Length=227, Percent_Identity=32.15859030837, Blast_Score=80, Evalue=4e-15,
Organism=Drosophila melanogaster, GI19921840, Length=392, Percent_Identity=25.765306122449, Blast_Score=79, Evalue=7e-15,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 72230; Mature: 72230

Theoretical pI: Translated: 5.82; Mature: 5.82

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

2.5 %Cys     (Translated Protein)
0.6 %Met     (Translated Protein)
3.1 %Cys+Met (Translated Protein)
2.5 %Cys     (Mature Protein)
0.6 %Met     (Mature Protein)
3.1 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MNIPTLSYSYLVNTMTTSDYQSQEISDLSRDEDIPLGNSLANIEETSAPTIQVHDFSSSS
CCCCCCCHHHHHHHHCCCCCCHHHHHHCCCCCCCCCCCCCCCCCCCCCCEEEEECCCCCC
EELQLSFQEGTSLTISHSQLAMLREKSLYFKTLWSGNFQETLQHPLALTQKEFTHLLNCV
CCEEEEECCCCEEEEEHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHH
MDANFKVPLEEITSSIQLADYYELTEVVKNLEEQLIEGYRTQEFEPFSSTEESLVALKEL
HCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCHHHHHHHHHHH
LNFAHRYQLSTLKNYLELTVVSALLNQTSQLTEFEKIIKHFLNEIEAFNFSDNAYLTDAH
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCEECHHH
LLALKDCKNLKVLHLEKCQVITDDGLAHLTPLTALQHLELSDCRKLTDAGLAHLTPLTAL
HHHHHCCCCCEEEEECCCEEECCCCCHHHHHHHHHHHCCHHHHHHHHHCCHHHHHHHHHH
QHLNLSFCDKLTDAGLAHLTPLTALQHLNLSRCYYKLTDAGLAHLTPLTALQHLNLSFCD
HHCCHHHHHHHHHCCHHHHHHHHHHHHCCHHHHHHHHHHCCHHHHHHHHHHHHCCHHHHH
KLTDAGLVHLKLLTGLQHLDLREFWELTGAGLAHLTTLTALQHLDLSGCDKLTDVGLAHL
HHHCCCHHHHHHHHCCHHCCHHHHHHHHCCHHHHHHHHHHHHHCCCCCCHHHHHCCHHHH
TPLTTLQHLDLKRCRNLTNAGLVHLKLLTGLQHLNLSECYHLTDAGLAHLTPLTALQHLD
HHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHCCHHHHHHHHHCCHHHHHHHHHHHHCC
LSQCSKLTDDGLAHLTPLTALQHLDLSQCSKLTDDGLAHLTPLTALQHLVLARCRNLTDA
HHHHHHCCCCCHHHHHHHHHHHHCCHHHHHHCCCCCHHHHHHHHHHHHHHHHHHCCCCCC
GLAHLTPLETLQHLNLSGGYKLTGAGLAHLRPLVALQHLDLSYCNGLTDAGLAHLTPLVA
CHHHCCHHHHHHHCCCCCCEEECCCCHHHHHHHHHHHHCCHHHHCCCCCCHHHHHHHHHH
LQHLDLSYCDGLTDAGLTHLRPLVALQHLDLSYCDGLTDAGLAHFKFLAAIIH
HHHCCHHHHCCCCCCCHHHHHHHHHHHHCCHHHHCCCCCCHHHHHHHHHHHHC
>Mature Secondary Structure
MNIPTLSYSYLVNTMTTSDYQSQEISDLSRDEDIPLGNSLANIEETSAPTIQVHDFSSSS
CCCCCCCHHHHHHHHCCCCCCHHHHHHCCCCCCCCCCCCCCCCCCCCCCEEEEECCCCCC
EELQLSFQEGTSLTISHSQLAMLREKSLYFKTLWSGNFQETLQHPLALTQKEFTHLLNCV
CCEEEEECCCCEEEEEHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHH
MDANFKVPLEEITSSIQLADYYELTEVVKNLEEQLIEGYRTQEFEPFSSTEESLVALKEL
HCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCHHHHHHHHHHH
LNFAHRYQLSTLKNYLELTVVSALLNQTSQLTEFEKIIKHFLNEIEAFNFSDNAYLTDAH
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCEECHHH
LLALKDCKNLKVLHLEKCQVITDDGLAHLTPLTALQHLELSDCRKLTDAGLAHLTPLTAL
HHHHHCCCCCEEEEECCCEEECCCCCHHHHHHHHHHHCCHHHHHHHHHCCHHHHHHHHHH
QHLNLSFCDKLTDAGLAHLTPLTALQHLNLSRCYYKLTDAGLAHLTPLTALQHLNLSFCD
HHCCHHHHHHHHHCCHHHHHHHHHHHHCCHHHHHHHHHHCCHHHHHHHHHHHHCCHHHHH
KLTDAGLVHLKLLTGLQHLDLREFWELTGAGLAHLTTLTALQHLDLSGCDKLTDVGLAHL
HHHCCCHHHHHHHHCCHHCCHHHHHHHHCCHHHHHHHHHHHHHCCCCCCHHHHHCCHHHH
TPLTTLQHLDLKRCRNLTNAGLVHLKLLTGLQHLNLSECYHLTDAGLAHLTPLTALQHLD
HHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHCCHHHHHHHHHCCHHHHHHHHHHHHCC
LSQCSKLTDDGLAHLTPLTALQHLDLSQCSKLTDDGLAHLTPLTALQHLVLARCRNLTDA
HHHHHHCCCCCHHHHHHHHHHHHCCHHHHHHCCCCCHHHHHHHHHHHHHHHHHHCCCCCC
GLAHLTPLETLQHLNLSGGYKLTGAGLAHLRPLVALQHLDLSYCNGLTDAGLAHLTPLVA
CHHHCCHHHHHHHCCCCCCEEECCCCHHHHHHHHHHHHCCHHHHCCCCCCHHHHHHHHHH
LQHLDLSYCDGLTDAGLTHLRPLVALQHLDLSYCDGLTDAGLAHFKFLAAIIH
HHHCCHHHHCCCCCCCHHHHHHHHHHHHCCHHHHCCCCCCHHHHHHHHHHHHC

PDB accession: NA

Resolution: NA

Structure class: Alpha

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA