Definition Candidatus Protochlamydia amoebophila UWE25, complete genome.
Accession NC_005861
Length 2,414,465

Click here to switch to the map view.

The map label for this gene is 46447129

Identifier: 46447129

GI number: 46447129

Start: 1778935

End: 1780614

Strand: Direct

Name: 46447129

Synonym: pc1495

Alternate gene names: NA

Gene position: 1778935-1780614 (Clockwise)

Preceding gene: 46447128

Following gene: 46447130

Centisome position: 73.68

GC content: 38.04

Gene sequence:

>1680_bases
TTGCATATTTCTAGTTTTGAGCTTAATTCTAGTCATCTTGTCTATACAACGCTTCCACCTTACTATCCCCTTCAAGACAT
TAACGATCAACTTGAGAATGAAAATACTTCCTTAGATAATTCTTTGCCTAATCTAGAAGAAACTAATGCACCAACGATTC
CAGCTCCCACTCTTTTACCTTCATCTGATGAAATTCAAATAAGCTTTCAAGAGGGAACTTCTCTAACTATTTCTCACTCT
CAGCTAGCTTTATTAAGGGAAAAATCACACTACTTTAAGAATCTGTGGTCGGGGCAATTTCAAGAAACCCTGCAACACCC
TCTCGATTTAACACAAAAAGATTTTACGCTTTTACTCAATTGCCTGATGGACGCTAACTTTAAAGTTCCCTTAGAAGAGA
TCTCTTCTTCTATTCAACTCGCCGATTATTATGAACTAACAGGAGTGGTAAAAAGTTTAGAAGAGCAACTGATTGATGGA
TACAAATCACAGAAATTTGAAACTTTTAACTCAACTGAAGAAAGTTTAATCGGATTAAAAGAGCTTTTAAATTTTGCGCA
TCGCTGTCAATTAAATAGATTGAAAAACTATTTAGAATTTATTGTTGTGAGCACCTTATTAAACCAGACCAGTCAGTTAG
CGGAGTTTGAAAGAATTATAAATCACCTCTCAAATGAGATAGAAGCACTCAATTTTTCAAACAATACTTATTTAACAGAT
GCTCATTTCTCAGCTTTAAAAGATTGTAAAAATTTAAAAGTGCTTCATTTAGTGTCATGCCAGGCTATTACGGACGATAG
ATTAGCGCATTTAACACCCTTAACGGCTTTGCAGCATCTAAATCTAAGTAAGTGCAGGAAACTCACCGATACAGGCTTGG
TTCATTTAACACCCTTAACGGCTTTGCAGCATCTAGATTTAAGCTACTGTAAAAATCTCACCGATGCAGGATTAGCGCAT
TTAACACCCTTGAAGGCTTTGCAGCATCTAAATTTACGTGGCTTTGGAAAACTTACCGATGCAGGTTTGGTTCATTTAAC
ACCCTTAACGGCTTTGCAGTATTTAGATCTAAGTTGGTGCAAGAATCTCACCGATGCAGGATTAGCCCATTTGACACCTT
TAACTGGTTTGCAGCATCTAAATCTGAGTGGGTGGTATCATCTCACCGATGCAGGATTAGCCCGTTTAATATTTTTAACA
GCTTTGCAGCATTTAGATTTAAGCGATTGTGAGAATCTCACTAGTGCAGGATTAGAACGTTTGACATCCTTAACCGCTTT
GCAACATCTAGGTCTAAGCTACTGTATGAATCTCACCGATGCAGGCTTGATTCATTTAACACCTTTAACTGCTTTGCAGC
ATCTAAATCTGAGTGGGTGCTTTCATCTCACCGATGCAGGATTAGTCCATTTGACACCCTTAACGGCTTTGCAGCATCTT
AATCTAGGTGGGTGTGAGAATCTCACCGATGCAGGATTAGCCTATTTGACACCCTTAACGGCTTTGCAGCATCTAAATCT
AAGTAGGTGCAAGCATCTCACCGAGGCAGGATTAACCCATTTGGCATCTTTAACAGCTTTGCAGCATCTAAATCTAAGCT
ATTGCGATAATCTCACCGATGCAGGATTAGAACGTTTTAAAGCTTTAGCAGCTTCACTCAATTTAAAAATTATTAGATAG

Upstream 100 bases:

>100_bases
CCTATTTTAATTTATTAATATTGCAATAATTTTTATCTATACATCATAATTTTAAAATATCTATAAATTAAAATTTATTG
CACTCATTGGGATGGTCATT

Downstream 100 bases:

>100_bases
AAAAAACTTTCAATAAAAGAGAAACCTGGCGGCGAAAATAAAAGAGTGCTTTCCCCTAAGAAAGTGAAGGATAAAATTTC
ATTAAAGTTTATCGACTCCC

Product: hypothetical protein

Products: NA

Alternate protein names: None

Number of amino acids: Translated: 559; Mature: 559

Protein sequence:

>559_residues
MHISSFELNSSHLVYTTLPPYYPLQDINDQLENENTSLDNSLPNLEETNAPTIPAPTLLPSSDEIQISFQEGTSLTISHS
QLALLREKSHYFKNLWSGQFQETLQHPLDLTQKDFTLLLNCLMDANFKVPLEEISSSIQLADYYELTGVVKSLEEQLIDG
YKSQKFETFNSTEESLIGLKELLNFAHRCQLNRLKNYLEFIVVSTLLNQTSQLAEFERIINHLSNEIEALNFSNNTYLTD
AHFSALKDCKNLKVLHLVSCQAITDDRLAHLTPLTALQHLNLSKCRKLTDTGLVHLTPLTALQHLDLSYCKNLTDAGLAH
LTPLKALQHLNLRGFGKLTDAGLVHLTPLTALQYLDLSWCKNLTDAGLAHLTPLTGLQHLNLSGWYHLTDAGLARLIFLT
ALQHLDLSDCENLTSAGLERLTSLTALQHLGLSYCMNLTDAGLIHLTPLTALQHLNLSGCFHLTDAGLVHLTPLTALQHL
NLGGCENLTDAGLAYLTPLTALQHLNLSRCKHLTEAGLTHLASLTALQHLNLSYCDNLTDAGLERFKALAASLNLKIIR

Sequences:

>Translated_559_residues
MHISSFELNSSHLVYTTLPPYYPLQDINDQLENENTSLDNSLPNLEETNAPTIPAPTLLPSSDEIQISFQEGTSLTISHS
QLALLREKSHYFKNLWSGQFQETLQHPLDLTQKDFTLLLNCLMDANFKVPLEEISSSIQLADYYELTGVVKSLEEQLIDG
YKSQKFETFNSTEESLIGLKELLNFAHRCQLNRLKNYLEFIVVSTLLNQTSQLAEFERIINHLSNEIEALNFSNNTYLTD
AHFSALKDCKNLKVLHLVSCQAITDDRLAHLTPLTALQHLNLSKCRKLTDTGLVHLTPLTALQHLDLSYCKNLTDAGLAH
LTPLKALQHLNLRGFGKLTDAGLVHLTPLTALQYLDLSWCKNLTDAGLAHLTPLTGLQHLNLSGWYHLTDAGLARLIFLT
ALQHLDLSDCENLTSAGLERLTSLTALQHLGLSYCMNLTDAGLIHLTPLTALQHLNLSGCFHLTDAGLVHLTPLTALQHL
NLGGCENLTDAGLAYLTPLTALQHLNLSRCKHLTEAGLTHLASLTALQHLNLSYCDNLTDAGLERFKALAASLNLKIIR
>Mature_559_residues
MHISSFELNSSHLVYTTLPPYYPLQDINDQLENENTSLDNSLPNLEETNAPTIPAPTLLPSSDEIQISFQEGTSLTISHS
QLALLREKSHYFKNLWSGQFQETLQHPLDLTQKDFTLLLNCLMDANFKVPLEEISSSIQLADYYELTGVVKSLEEQLIDG
YKSQKFETFNSTEESLIGLKELLNFAHRCQLNRLKNYLEFIVVSTLLNQTSQLAEFERIINHLSNEIEALNFSNNTYLTD
AHFSALKDCKNLKVLHLVSCQAITDDRLAHLTPLTALQHLNLSKCRKLTDTGLVHLTPLTALQHLDLSYCKNLTDAGLAH
LTPLKALQHLNLRGFGKLTDAGLVHLTPLTALQYLDLSWCKNLTDAGLAHLTPLTGLQHLNLSGWYHLTDAGLARLIFLT
ALQHLDLSDCENLTSAGLERLTSLTALQHLGLSYCMNLTDAGLIHLTPLTALQHLNLSGCFHLTDAGLVHLTPLTALQHL
NLGGCENLTDAGLAYLTPLTALQHLNLSRCKHLTEAGLTHLASLTALQHLNLSYCDNLTDAGLERFKALAASLNLKIIR

Specific function: Unknown

COG id: NA

COG function: NA

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: NA

Homologues:

Organism=Homo sapiens, GI22748931, Length=282, Percent_Identity=33.6879432624113, Blast_Score=130, Evalue=2e-30,
Organism=Homo sapiens, GI284447308, Length=310, Percent_Identity=32.9032258064516, Blast_Score=113, Evalue=5e-25,
Organism=Homo sapiens, GI6912466, Length=299, Percent_Identity=30.4347826086957, Blast_Score=112, Evalue=1e-24,
Organism=Homo sapiens, GI161333852, Length=396, Percent_Identity=26.2626262626263, Blast_Score=110, Evalue=3e-24,
Organism=Homo sapiens, GI161333854, Length=394, Percent_Identity=26.1421319796954, Blast_Score=109, Evalue=9e-24,
Organism=Homo sapiens, GI27734755, Length=423, Percent_Identity=26.241134751773, Blast_Score=105, Evalue=2e-22,
Organism=Homo sapiens, GI284447314, Length=272, Percent_Identity=32.7205882352941, Blast_Score=92, Evalue=1e-18,
Organism=Homo sapiens, GI296531375, Length=411, Percent_Identity=26.5206812652068, Blast_Score=91, Evalue=2e-18,
Organism=Homo sapiens, GI289666746, Length=242, Percent_Identity=35.5371900826446, Blast_Score=79, Evalue=1e-14,
Organism=Caenorhabditis elegans, GI25151694, Length=307, Percent_Identity=28.9902280130293, Blast_Score=93, Evalue=3e-19,
Organism=Caenorhabditis elegans, GI25151696, Length=307, Percent_Identity=28.9902280130293, Blast_Score=93, Evalue=3e-19,
Organism=Saccharomyces cerevisiae, GI6322549, Length=394, Percent_Identity=29.4416243654822, Blast_Score=115, Evalue=3e-26,
Organism=Drosophila melanogaster, GI17647819, Length=302, Percent_Identity=32.7814569536424, Blast_Score=120, Evalue=3e-27,
Organism=Drosophila melanogaster, GI21357913, Length=284, Percent_Identity=32.0422535211268, Blast_Score=96, Evalue=9e-20,
Organism=Drosophila melanogaster, GI24662818, Length=377, Percent_Identity=29.7082228116711, Blast_Score=91, Evalue=2e-18,
Organism=Drosophila melanogaster, GI24652783, Length=286, Percent_Identity=29.7202797202797, Blast_Score=76, Evalue=6e-14,
Organism=Drosophila melanogaster, GI161076547, Length=286, Percent_Identity=29.7202797202797, Blast_Score=76, Evalue=8e-14,
Organism=Drosophila melanogaster, GI161076545, Length=286, Percent_Identity=29.7202797202797, Blast_Score=75, Evalue=8e-14,
Organism=Drosophila melanogaster, GI161076549, Length=286, Percent_Identity=29.7202797202797, Blast_Score=75, Evalue=1e-13,
Organism=Drosophila melanogaster, GI24646754, Length=205, Percent_Identity=33.1707317073171, Blast_Score=75, Evalue=1e-13,
Organism=Drosophila melanogaster, GI19921840, Length=349, Percent_Identity=26.9340974212034, Blast_Score=69, Evalue=6e-12,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

NA

Pfam domain/function: NA

EC number: NA

Molecular weight: Translated: 62103; Mature: 62103

Theoretical pI: Translated: 6.09; Mature: 6.09

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

2.3 %Cys     (Translated Protein)
0.5 %Met     (Translated Protein)
2.9 %Cys+Met (Translated Protein)
2.3 %Cys     (Mature Protein)
0.5 %Met     (Mature Protein)
2.9 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MHISSFELNSSHLVYTTLPPYYPLQDINDQLENENTSLDNSLPNLEETNAPTIPAPTLLP
CCCCCEECCCCEEEEEECCCCCCHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCC
SSDEIQISFQEGTSLTISHSQLALLREKSHYFKNLWSGQFQETLQHPLDLTQKDFTLLLN
CCCCEEEEEECCCEEEEEHHHHHHHHHHHHHHHHHHCHHHHHHHHCHHCCCHHHHHHHHH
CLMDANFKVPLEEISSSIQLADYYELTGVVKSLEEQLIDGYKSQKFETFNSTEESLIGLK
HHHCCCCCCCHHHHHCCCCHHHHHHHHHHHHHHHHHHHCCHHHCCCCCCCCHHHHHHHHH
ELLNFAHRCQLNRLKNYLEFIVVSTLLNQTSQLAEFERIINHLSNEIEALNFSNNTYLTD
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHEEEECCCCEEEEH
AHFSALKDCKNLKVLHLVSCQAITDDRLAHLTPLTALQHLNLSKCRKLTDTGLVHLTPLT
HHHHHHHHHCCCCEEEEEEHHHCCCCHHHHHHHHHHHHHCCHHHHHHHHHCCCEEECHHH
ALQHLDLSYCKNLTDAGLAHLTPLKALQHLNLRGFGKLTDAGLVHLTPLTALQYLDLSWC
HHHHCCHHHHCCCHHCCHHHHHHHHHHHHCCCCCCCCCCCCCEEEECHHHHHHHHHHHHH
KNLTDAGLAHLTPLTGLQHLNLSGWYHLTDAGLARLIFLTALQHLDLSDCENLTSAGLER
CCCHHCCHHHHCHHCCCCCCCCCCEEEEHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHH
LTSLTALQHLGLSYCMNLTDAGLIHLTPLTALQHLNLSGCFHLTDAGLVHLTPLTALQHL
HHHHHHHHHHHHHHHHCCCCCCEEEECHHHHHHHCCCCCEEEECCCCEEEECHHHHHHHC
NLGGCENLTDAGLAYLTPLTALQHLNLSRCKHLTEAGLTHLASLTALQHLNLSYCDNLTD
CCCCCCCCHHCHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHCCHHHHCCCHH
AGLERFKALAASLNLKIIR
HHHHHHHHHHHHCCCEEEC
>Mature Secondary Structure
MHISSFELNSSHLVYTTLPPYYPLQDINDQLENENTSLDNSLPNLEETNAPTIPAPTLLP
CCCCCEECCCCEEEEEECCCCCCHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCC
SSDEIQISFQEGTSLTISHSQLALLREKSHYFKNLWSGQFQETLQHPLDLTQKDFTLLLN
CCCCEEEEEECCCEEEEEHHHHHHHHHHHHHHHHHHCHHHHHHHHCHHCCCHHHHHHHHH
CLMDANFKVPLEEISSSIQLADYYELTGVVKSLEEQLIDGYKSQKFETFNSTEESLIGLK
HHHCCCCCCCHHHHHCCCCHHHHHHHHHHHHHHHHHHHCCHHHCCCCCCCCHHHHHHHHH
ELLNFAHRCQLNRLKNYLEFIVVSTLLNQTSQLAEFERIINHLSNEIEALNFSNNTYLTD
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHEEEECCCCEEEEH
AHFSALKDCKNLKVLHLVSCQAITDDRLAHLTPLTALQHLNLSKCRKLTDTGLVHLTPLT
HHHHHHHHHCCCCEEEEEEHHHCCCCHHHHHHHHHHHHHCCHHHHHHHHHCCCEEECHHH
ALQHLDLSYCKNLTDAGLAHLTPLKALQHLNLRGFGKLTDAGLVHLTPLTALQYLDLSWC
HHHHCCHHHHCCCHHCCHHHHHHHHHHHHCCCCCCCCCCCCCEEEECHHHHHHHHHHHHH
KNLTDAGLAHLTPLTGLQHLNLSGWYHLTDAGLARLIFLTALQHLDLSDCENLTSAGLER
CCCHHCCHHHHCHHCCCCCCCCCCEEEEHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHH
LTSLTALQHLGLSYCMNLTDAGLIHLTPLTALQHLNLSGCFHLTDAGLVHLTPLTALQHL
HHHHHHHHHHHHHHHHCCCCCCEEEECHHHHHHHCCCCCEEEECCCCEEEECHHHHHHHC
NLGGCENLTDAGLAYLTPLTALQHLNLSRCKHLTEAGLTHLASLTALQHLNLSYCDNLTD
CCCCCCCCHHCHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHCCHHHHCCCHH
AGLERFKALAASLNLKIIR
HHHHHHHHHHHHCCCEEEC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: NA