| Definition | Candidatus Protochlamydia amoebophila UWE25, complete genome. |
|---|---|
| Accession | NC_005861 |
| Length | 2,414,465 |
Click here to switch to the map view.
The map label for this gene is 46447590
Identifier: 46447590
GI number: 46447590
Start: 2326645
End: 2328624
Strand: Reverse
Name: 46447590
Synonym: pc1956
Alternate gene names: NA
Gene position: 2328624-2326645 (Counterclockwise)
Preceding gene: 46447592
Following gene: 46447589
Centisome position: 96.44
GC content: 38.48
Gene sequence:
>1980_bases TTGAATATTTCTAATTCAAGATTTAGGCATAGCTATCTTGTCAATACAACGACTCTTTCTTACTCCCAATCTCAAGAGAT TAATGACCCTCTTGTGGATGAAAATAATCCCTTAGACAATCCTTTGGCTAATATAGAGGAAACTAGTGAGTCAACGATTC CAGCTTCCGATCTTTCATCATCACCTGAAGAAGTTCAACTAAGTTTTCAAGAGGGAACTTCTCTAACTATTTCTCATTCT CAACTAGTTTTGTTAAGGGACAAATCACACTACTTTAACAATCTGTGGTCGGGGCAGTTTCAAGAAACCCTGCAACATCC TCTGGCTTTGACACAAAAAGAGTTTACGCTTTTGCTCAATTGTCTAATGAATCCTAAGTTTGAAATTCCCTTGGAAGAGA TCACTTCTGTTATTCAACTTGCCGATTATTATGAAGTGACAGAAGTAGTGAAACATTTAGAAGGACAGCTGATCATTGGA TACAAATCACAGAGATTTGAACCCTTTAACTCCACTGAAGAAAGTTTAGTCGAATTAAAAGAGCTTTTAAATTTCGCGCA TCGCTGTCAATTAAATACATTGAAGAATTATTTGGAGTTTTCCGTTACAAGCGCATTATTAAACCAAACTTCCCAATTAA CGGAATTTCAAAGAATTATAAATCAATTCTCAAATGAAATAGAAGCACTTAATTTTTCAGAAAATGCCCATTTGACCGAT GCTCATCTTTTAGCATTAAAAAATTGTAAAAATTTAAAAGAGCTTCATCTTCAAGAGTGCCGTAATCTTACTGATGCTGG ATTAGTGCATTTGGCACCCTTAGTGGCTTTAAAGCATTTAAATCTTAACTTTTGCGATAAACTCACCAATACAGGATTAG CCCATTTGAGACCCTTAACAGCTTTACAGCATCTAAATTTGGGTAATTGTAGAAATCTCACTGATGCAGGATTAGCGCAT TTGACTCCTTTAACGGCTTTGCAACATCTAAATCTTAACTTTTGTGATAAACTCACCGATACAGGATTAGTCCGTTTAAG TCCCTTAACAGCTTTGCAACACCTAGATTTAAGCGATTGTGAGAATCTCACCGATGCAGGATTAGTTCATTTGAAGCCCT TAGTGGCTTTGCAGCATCTAAATCTAAGCTGCTGTGAAAACCTCACCGATGCAGGATTAGTTCATTTGAAGCTCTTAGTG GCTTTGCAGCATCTAGATTTAAGCGATTGTAATAACCTCACCGATGCAGGATTAGCCCATTTGACACCCTTAACGGCCTT GCAGTATCTAGATTTAAGCTATTGCAATAATCTCACCGACGCAGGATTAGTTCATTTGAAATTCTTAACGGCCTTGCAGC ATCTAGATTTGAGGGGCTGTGACAAAGTCGCGGATGACGGGTTAGCGCATTTGACACCCTTAACCGCTTTGCAAGCTCTA AGTCTAAGCCAATGTCGAAATCTCACCGATGCAGGATTAGGCCATTTGAAACTCTTAACGGCTTTGCAATATCTACGCCT AAGTCAATGCTGGAATCTCACTGATGCAGGATTAATTCATTTGAGGCCCTTAGTGGCTTTACAACATCTAGACCTAAGTT ACTGCGGAAATCTCACCGATGTGGGATTAGTGCATTTAACACCTTTAATGGCTCTACAACATTTAGATCTAAACTACTGT GAGAATCTCACTGGTGATGGATTAGCCCATTTGAGATCCTTAACGACTTTGCAGCATCTAAGTCTAAACCAGTGCTGGAA TCTTACCGATGCAGGATTAGTTCATTTGGAACCCTTAACGGCTTTGCAGCATCTAGACCTAAGTTACTGCGGAAATTTCA CCGATGTGGGATTAGTGCATTTAACATCCTTAATGGCTTTGCAGCATCTAAATCTGAGGGGATGTGACAGAGTCACGGAT GTTGGATTAGCTCTTTTTAAAATTTTTGCAACTTCACTCCATCTAAAAATTATTAAATAG
Upstream 100 bases:
>100_bases AAGCATTTTTATATCAAAAGCTAAGGAGTTTATATTTGAATTTTATCGAATTATTAAAACATTTATAATTAATCGAAATT AATTCATTTGGAGAATCATT
Downstream 100 bases:
>100_bases AAAAACTTTCAATAAAAAGAGAAACCTGGCGGTGAAAATAAAAGAGTTCTTTGCCTTAAGAAAATAAAGGATAAAATTTT ATTAACGTTTCTCAATTTCC
Product: hypothetical protein
Products: NA
Alternate protein names: None
Number of amino acids: Translated: 659; Mature: 659
Protein sequence:
>659_residues MNISNSRFRHSYLVNTTTLSYSQSQEINDPLVDENNPLDNPLANIEETSESTIPASDLSSSPEEVQLSFQEGTSLTISHS QLVLLRDKSHYFNNLWSGQFQETLQHPLALTQKEFTLLLNCLMNPKFEIPLEEITSVIQLADYYEVTEVVKHLEGQLIIG YKSQRFEPFNSTEESLVELKELLNFAHRCQLNTLKNYLEFSVTSALLNQTSQLTEFQRIINQFSNEIEALNFSENAHLTD AHLLALKNCKNLKELHLQECRNLTDAGLVHLAPLVALKHLNLNFCDKLTNTGLAHLRPLTALQHLNLGNCRNLTDAGLAH LTPLTALQHLNLNFCDKLTDTGLVRLSPLTALQHLDLSDCENLTDAGLVHLKPLVALQHLNLSCCENLTDAGLVHLKLLV ALQHLDLSDCNNLTDAGLAHLTPLTALQYLDLSYCNNLTDAGLVHLKFLTALQHLDLRGCDKVADDGLAHLTPLTALQAL SLSQCRNLTDAGLGHLKLLTALQYLRLSQCWNLTDAGLIHLRPLVALQHLDLSYCGNLTDVGLVHLTPLMALQHLDLNYC ENLTGDGLAHLRSLTTLQHLSLNQCWNLTDAGLVHLEPLTALQHLDLSYCGNFTDVGLVHLTSLMALQHLNLRGCDRVTD VGLALFKIFATSLHLKIIK
Sequences:
>Translated_659_residues MNISNSRFRHSYLVNTTTLSYSQSQEINDPLVDENNPLDNPLANIEETSESTIPASDLSSSPEEVQLSFQEGTSLTISHS QLVLLRDKSHYFNNLWSGQFQETLQHPLALTQKEFTLLLNCLMNPKFEIPLEEITSVIQLADYYEVTEVVKHLEGQLIIG YKSQRFEPFNSTEESLVELKELLNFAHRCQLNTLKNYLEFSVTSALLNQTSQLTEFQRIINQFSNEIEALNFSENAHLTD AHLLALKNCKNLKELHLQECRNLTDAGLVHLAPLVALKHLNLNFCDKLTNTGLAHLRPLTALQHLNLGNCRNLTDAGLAH LTPLTALQHLNLNFCDKLTDTGLVRLSPLTALQHLDLSDCENLTDAGLVHLKPLVALQHLNLSCCENLTDAGLVHLKLLV ALQHLDLSDCNNLTDAGLAHLTPLTALQYLDLSYCNNLTDAGLVHLKFLTALQHLDLRGCDKVADDGLAHLTPLTALQAL SLSQCRNLTDAGLGHLKLLTALQYLRLSQCWNLTDAGLIHLRPLVALQHLDLSYCGNLTDVGLVHLTPLMALQHLDLNYC ENLTGDGLAHLRSLTTLQHLSLNQCWNLTDAGLVHLEPLTALQHLDLSYCGNFTDVGLVHLTSLMALQHLNLRGCDRVTD VGLALFKIFATSLHLKIIK >Mature_659_residues MNISNSRFRHSYLVNTTTLSYSQSQEINDPLVDENNPLDNPLANIEETSESTIPASDLSSSPEEVQLSFQEGTSLTISHS QLVLLRDKSHYFNNLWSGQFQETLQHPLALTQKEFTLLLNCLMNPKFEIPLEEITSVIQLADYYEVTEVVKHLEGQLIIG YKSQRFEPFNSTEESLVELKELLNFAHRCQLNTLKNYLEFSVTSALLNQTSQLTEFQRIINQFSNEIEALNFSENAHLTD AHLLALKNCKNLKELHLQECRNLTDAGLVHLAPLVALKHLNLNFCDKLTNTGLAHLRPLTALQHLNLGNCRNLTDAGLAH LTPLTALQHLNLNFCDKLTDTGLVRLSPLTALQHLDLSDCENLTDAGLVHLKPLVALQHLNLSCCENLTDAGLVHLKLLV ALQHLDLSDCNNLTDAGLAHLTPLTALQYLDLSYCNNLTDAGLVHLKFLTALQHLDLRGCDKVADDGLAHLTPLTALQAL SLSQCRNLTDAGLGHLKLLTALQYLRLSQCWNLTDAGLIHLRPLVALQHLDLSYCGNLTDVGLVHLTPLMALQHLDLNYC ENLTGDGLAHLRSLTTLQHLSLNQCWNLTDAGLVHLEPLTALQHLDLSYCGNFTDVGLVHLTSLMALQHLNLRGCDRVTD VGLALFKIFATSLHLKIIK
Specific function: Unknown
COG id: NA
COG function: NA
Gene ontology:
Cell location: Cytoplasmic
Metaboloic importance: NA
Operon status: Not Known
Operon components: None
Similarity: NA
Homologues:
Organism=Homo sapiens, GI22748931, Length=313, Percent_Identity=34.8242811501597, Blast_Score=153, Evalue=5e-37, Organism=Homo sapiens, GI161333852, Length=491, Percent_Identity=26.8839103869654, Blast_Score=127, Evalue=5e-29, Organism=Homo sapiens, GI284447308, Length=337, Percent_Identity=33.8278931750742, Blast_Score=123, Evalue=5e-28, Organism=Homo sapiens, GI6912466, Length=296, Percent_Identity=30.7432432432432, Blast_Score=114, Evalue=4e-25, Organism=Homo sapiens, GI27734755, Length=405, Percent_Identity=30.1234567901235, Blast_Score=113, Evalue=7e-25, Organism=Homo sapiens, GI296531375, Length=397, Percent_Identity=29.7229219143577, Blast_Score=107, Evalue=3e-23, Organism=Homo sapiens, GI161333854, Length=491, Percent_Identity=26.2729124236253, Blast_Score=107, Evalue=5e-23, Organism=Homo sapiens, GI289666746, Length=244, Percent_Identity=35.2459016393443, Blast_Score=94, Evalue=5e-19, Organism=Homo sapiens, GI284447314, Length=259, Percent_Identity=32.8185328185328, Blast_Score=91, Evalue=3e-18, Organism=Caenorhabditis elegans, GI25151694, Length=332, Percent_Identity=31.9277108433735, Blast_Score=120, Evalue=2e-27, Organism=Caenorhabditis elegans, GI25151696, Length=332, Percent_Identity=31.9277108433735, Blast_Score=120, Evalue=2e-27, Organism=Saccharomyces cerevisiae, GI6322549, Length=371, Percent_Identity=28.5714285714286, Blast_Score=90, Evalue=1e-18, Organism=Drosophila melanogaster, GI17647819, Length=302, Percent_Identity=35.7615894039735, Blast_Score=147, Evalue=2e-35, Organism=Drosophila melanogaster, GI21357913, Length=243, Percent_Identity=35.8024691358025, Blast_Score=104, Evalue=2e-22, Organism=Drosophila melanogaster, GI24662818, Length=233, Percent_Identity=35.1931330472103, Blast_Score=102, Evalue=6e-22, Organism=Drosophila melanogaster, GI161076545, Length=333, Percent_Identity=29.7297297297297, Blast_Score=86, Evalue=7e-17, Organism=Drosophila melanogaster, GI161076549, Length=333, Percent_Identity=28.5285285285285, Blast_Score=86, Evalue=9e-17, Organism=Drosophila melanogaster, GI24652783, Length=333, Percent_Identity=28.5285285285285, Blast_Score=86, Evalue=1e-16, Organism=Drosophila melanogaster, GI161076547, Length=333, Percent_Identity=28.5285285285285, Blast_Score=85, Evalue=1e-16, Organism=Drosophila melanogaster, GI24646754, Length=330, Percent_Identity=29.3939393939394, Blast_Score=77, Evalue=5e-14, Organism=Drosophila melanogaster, GI19921840, Length=460, Percent_Identity=25.6521739130435, Blast_Score=71, Evalue=3e-12,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
NA
Pfam domain/function: NA
EC number: NA
Molecular weight: Translated: 73346; Mature: 73346
Theoretical pI: Translated: 5.87; Mature: 5.87
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
3.0 %Cys (Translated Protein) 0.6 %Met (Translated Protein) 3.6 %Cys+Met (Translated Protein) 3.0 %Cys (Mature Protein) 0.6 %Met (Mature Protein) 3.6 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MNISNSRFRHSYLVNTTTLSYSQSQEINDPLVDENNPLDNPLANIEETSESTIPASDLSS CCCCCCCHHHEEEEEEEEECCCCCCCCCCCCCCCCCCCCCCHHHHHHCCCCCCCCHHCCC SPEEVQLSFQEGTSLTISHSQLVLLRDKSHYFNNLWSGQFQETLQHPLALTQKEFTLLLN CHHHEEEEECCCCEEEEECCEEEEEECCHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHH CLMNPKFEIPLEEITSVIQLADYYEVTEVVKHLEGQLIIGYKSQRFEPFNSTEESLVELK HHCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCEEEEECCCCCCCCCCHHHHHHHHH ELLNFAHRCQLNTLKNYLEFSVTSALLNQTSQLTEFQRIINQFSNEIEALNFSENAHLTD HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHEECCCCCCCCCH AHLLALKNCKNLKELHLQECRNLTDAGLVHLAPLVALKHLNLNFCDKLTNTGLAHLRPLT HHHHHHHHHCCHHHHHHHHHCCCCHHHHHHHHHHHHHHHCCCHHHHHHHCCCHHHHHHHH ALQHLNLGNCRNLTDAGLAHLTPLTALQHLNLNFCDKLTDTGLVRLSPLTALQHLDLSDC HHHHCCCCCCCCCCHHHHHHHHHHHHHHHCCCHHHHHHCCCCCEEECHHHHHHHCCHHHH ENLTDAGLVHLKPLVALQHLNLSCCENLTDAGLVHLKLLVALQHLDLSDCNNLTDAGLAH CCCHHCCHHHHHHHHHHHHCCHHHHCCCHHHHHHHHHHHHHHHHCCHHHCCCCHHCCHHH LTPLTALQYLDLSYCNNLTDAGLVHLKFLTALQHLDLRGCDKVADDGLAHLTPLTALQAL HHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHCCCCCCHHHHCCCHHHHHHHHHHHHH SLSQCRNLTDAGLGHLKLLTALQYLRLSQCWNLTDAGLIHLRPLVALQHLDLSYCGNLTD HHHHHCCCHHCCCHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHCCHHHCCCCCH VGLVHLTPLMALQHLDLNYCENLTGDGLAHLRSLTTLQHLSLNQCWNLTDAGLVHLEPLT HHHHHHHHHHHHHHCCHHHHCCCCCCHHHHHHHHHHHHHCCHHHHCCCCCCCEEEECHHH ALQHLDLSYCGNFTDVGLVHLTSLMALQHLNLRGCDRVTDVGLALFKIFATSLHLKIIK HHHHCCHHHCCCCCHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHEEEEEC >Mature Secondary Structure MNISNSRFRHSYLVNTTTLSYSQSQEINDPLVDENNPLDNPLANIEETSESTIPASDLSS CCCCCCCHHHEEEEEEEEECCCCCCCCCCCCCCCCCCCCCCHHHHHHCCCCCCCCHHCCC SPEEVQLSFQEGTSLTISHSQLVLLRDKSHYFNNLWSGQFQETLQHPLALTQKEFTLLLN CHHHEEEEECCCCEEEEECCEEEEEECCHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHH CLMNPKFEIPLEEITSVIQLADYYEVTEVVKHLEGQLIIGYKSQRFEPFNSTEESLVELK HHCCCCCCCCHHHHHHHHHHHHHHHHHHHHHHHCCCEEEEECCCCCCCCCCHHHHHHHHH ELLNFAHRCQLNTLKNYLEFSVTSALLNQTSQLTEFQRIINQFSNEIEALNFSENAHLTD HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHEECCCCCCCCCH AHLLALKNCKNLKELHLQECRNLTDAGLVHLAPLVALKHLNLNFCDKLTNTGLAHLRPLT HHHHHHHHHCCHHHHHHHHHCCCCHHHHHHHHHHHHHHHCCCHHHHHHHCCCHHHHHHHH ALQHLNLGNCRNLTDAGLAHLTPLTALQHLNLNFCDKLTDTGLVRLSPLTALQHLDLSDC HHHHCCCCCCCCCCHHHHHHHHHHHHHHHCCCHHHHHHCCCCCEEECHHHHHHHCCHHHH ENLTDAGLVHLKPLVALQHLNLSCCENLTDAGLVHLKLLVALQHLDLSDCNNLTDAGLAH CCCHHCCHHHHHHHHHHHHCCHHHHCCCHHHHHHHHHHHHHHHHCCHHHCCCCHHCCHHH LTPLTALQYLDLSYCNNLTDAGLVHLKFLTALQHLDLRGCDKVADDGLAHLTPLTALQAL HHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHCCCCCCHHHHCCCHHHHHHHHHHHHH SLSQCRNLTDAGLGHLKLLTALQYLRLSQCWNLTDAGLIHLRPLVALQHLDLSYCGNLTD HHHHHCCCHHCCCHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHCCHHHCCCCCH VGLVHLTPLMALQHLDLNYCENLTGDGLAHLRSLTTLQHLSLNQCWNLTDAGLVHLEPLT HHHHHHHHHHHHHHCCHHHHCCCCCCHHHHHHHHHHHHHCCHHHHCCCCCCCEEEECHHH ALQHLDLSYCGNFTDVGLVHLTSLMALQHLNLRGCDRVTDVGLALFKIFATSLHLKIIK HHHHCCHHHCCCCCHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHEEEEEC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: NA