Definition Chlorobium tepidum TLS, complete genome.
Accession NC_002932
Length 2,154,946

Click here to switch to the map view.

The map label for this gene is 21674622

Identifier: 21674622

GI number: 21674622

Start: 1713243

End: 1714640

Strand: Direct

Name: 21674622

Synonym: CT1808

Alternate gene names: NA

Gene position: 1713243-1714640 (Clockwise)

Preceding gene: 21674621

Following gene: 21674623

Centisome position: 79.5

GC content: 55.65

Gene sequence:

>1398_bases
ATGAGTTTGCTTGATTTTTTTGATGACAACCTGAACCCATCGGAAGGTTTCTTCCCGGACAGGCCGGAAGGAGCTTCTGA
CCCTGATTCCATTCACGATCCAGAAGAACTTCTCGACCTTATCATCCAGCTCAACGAGGAAGGACTTCACGAAACATCGC
TCGTTGCAGCCCGACGGCTCGAAGAGCTCGCCCCCTACAACGCGGAAACCTGGTTTCACCTCGGCAACAGCCTGACGTTG
AACGGCCTTTTTGACGAGGCGCTCGAAGCGTTTCAGCGCGCCGTTCTGCTCAGCCCTGCCGATAATGAAATGGCCCTGAA
TCTCGCTTTGGCCTATTTCAATACCGGACGACTCGATGAAGCGCTCGAAGAGATCGAGCGTGTTGTCAGCGACTCCACCA
TAGCAAGAGATATCTGCTTCTACCGGGGACTCATTCTGCAACGACTCGAACGTTTCGAAGAGGCTGAAAAAAATTTCGAA
CAGACGCTGCAGCTCGATCCGGAGTTCGGAGAAGCCTGGTACGAGCTGGCCTACTCGCAGGACATTCTCGGCAAACTTGA
TAACAGTCTTGTCGCCTACGAGAAGGCCATCGACCTCGACCCGTACAATATCAACGCCTGGTACAACAAGGGACTCGTCC
TGAGCAAGCTCAAGCGTTACCCGGAAGCGCTCGAAGCCTACGACATGGCGCTCGTCATTTCCGAGGATTTCAGCTCGGCC
TGGTACAACCGTGCCAATGTGCTTGCCATCACCGGAAGAATCGAGGATGCTGCCGAAAGCTACACGAAAACGCTTGAAAT
CGAGCCCGACGACATCAATGCGCTCTACAACCTCGGCATAGCCAGGGAGGAACTCGAGCAGTACAGCGAAGCGATCGCCT
GCTACAAACGCTGCATCGAACTGAATCCGGAGTTCGCCGACGCCTGGTTTGCGCTCGCCTGCTGCTTCGAGGCGCTCGAA
AACTACGAGGCTTCGCTCGACGCCATCGGCCATGCCCTTGTTGAAATGCCGGAGTGCATCGAATACCTCCTGCTCAAGGC
GGAGATCGAATACAATCTCGGCCGGCTCGACCAGTCGCTCAAAACCTACGAGAAAATTATCCCCCTGGATCCGGACAGCC
CTCAAATCTGGCTGGACTATGCAATGGTGCTGCGCGAGGCCGGAGCAATGGATGCATCGATCCGGGCGCTCGAAGAGTCG
ATCTCGCTTCAGCCGCTCTCGGCAGAGGCGCACTTCGAGATCGCGGCAACCTATTTCGCCATGGGCGACAACCAGAGCAC
CCTCAAGGCGCTCAGCAAGGCATTCAAGATCGACCCCGACAAAAAGCAGCTGTTTCAGAGCGTCTTCCCCGAGCTGTACC
AGCAAGATGCGGTACGCCGGCTGCTGGAAATTTCCTGA

Upstream 100 bases:

>100_bases
CTGAAGCCTGAAAGAATGGCCCGGCCGGGCACTTTTTTTGAAAAAATCTGCTATATTGGTTTTGTTATTATGATCGTGAA
ATTTGCACGAAAGAGAGTGT

Downstream 100 bases:

>100_bases
ACCACCAGCGAAACAAACATCGTGTCAAACTCTCAGTCCAAAAAGATTTTCGGACTCATCGGCAAACACGTCGATTACTC
CTGGTCGCCACTGATTCACA

Product: TPR domain-containing protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 465; Mature: 464

Protein sequence:

>465_residues
MSLLDFFDDNLNPSEGFFPDRPEGASDPDSIHDPEELLDLIIQLNEEGLHETSLVAARRLEELAPYNAETWFHLGNSLTL
NGLFDEALEAFQRAVLLSPADNEMALNLALAYFNTGRLDEALEEIERVVSDSTIARDICFYRGLILQRLERFEEAEKNFE
QTLQLDPEFGEAWYELAYSQDILGKLDNSLVAYEKAIDLDPYNINAWYNKGLVLSKLKRYPEALEAYDMALVISEDFSSA
WYNRANVLAITGRIEDAAESYTKTLEIEPDDINALYNLGIAREELEQYSEAIACYKRCIELNPEFADAWFALACCFEALE
NYEASLDAIGHALVEMPECIEYLLLKAEIEYNLGRLDQSLKTYEKIIPLDPDSPQIWLDYAMVLREAGAMDASIRALEES
ISLQPLSAEAHFEIAATYFAMGDNQSTLKALSKAFKIDPDKKQLFQSVFPELYQQDAVRRLLEIS

Sequences:

>Translated_465_residues
MSLLDFFDDNLNPSEGFFPDRPEGASDPDSIHDPEELLDLIIQLNEEGLHETSLVAARRLEELAPYNAETWFHLGNSLTL
NGLFDEALEAFQRAVLLSPADNEMALNLALAYFNTGRLDEALEEIERVVSDSTIARDICFYRGLILQRLERFEEAEKNFE
QTLQLDPEFGEAWYELAYSQDILGKLDNSLVAYEKAIDLDPYNINAWYNKGLVLSKLKRYPEALEAYDMALVISEDFSSA
WYNRANVLAITGRIEDAAESYTKTLEIEPDDINALYNLGIAREELEQYSEAIACYKRCIELNPEFADAWFALACCFEALE
NYEASLDAIGHALVEMPECIEYLLLKAEIEYNLGRLDQSLKTYEKIIPLDPDSPQIWLDYAMVLREAGAMDASIRALEES
ISLQPLSAEAHFEIAATYFAMGDNQSTLKALSKAFKIDPDKKQLFQSVFPELYQQDAVRRLLEIS
>Mature_464_residues
SLLDFFDDNLNPSEGFFPDRPEGASDPDSIHDPEELLDLIIQLNEEGLHETSLVAARRLEELAPYNAETWFHLGNSLTLN
GLFDEALEAFQRAVLLSPADNEMALNLALAYFNTGRLDEALEEIERVVSDSTIARDICFYRGLILQRLERFEEAEKNFEQ
TLQLDPEFGEAWYELAYSQDILGKLDNSLVAYEKAIDLDPYNINAWYNKGLVLSKLKRYPEALEAYDMALVISEDFSSAW
YNRANVLAITGRIEDAAESYTKTLEIEPDDINALYNLGIAREELEQYSEAIACYKRCIELNPEFADAWFALACCFEALEN
YEASLDAIGHALVEMPECIEYLLLKAEIEYNLGRLDQSLKTYEKIIPLDPDSPQIWLDYAMVLREAGAMDASIRALEESI
SLQPLSAEAHFEIAATYFAMGDNQSTLKALSKAFKIDPDKKQLFQSVFPELYQQDAVRRLLEIS

Specific function: Unknown

COG id: COG0457

COG function: function code R; FOG: TPR repeat

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Contains 8 TPR repeats [H]

Homologues:

Organism=Homo sapiens, GI32307148, Length=392, Percent_Identity=27.0408163265306, Blast_Score=126, Evalue=4e-29,
Organism=Homo sapiens, GI32307150, Length=392, Percent_Identity=27.0408163265306, Blast_Score=126, Evalue=4e-29,
Organism=Homo sapiens, GI224809432, Length=361, Percent_Identity=27.1468144044321, Blast_Score=105, Evalue=8e-23,
Organism=Homo sapiens, GI310131789, Length=342, Percent_Identity=21.3450292397661, Blast_Score=77, Evalue=3e-14,
Organism=Homo sapiens, GI310123097, Length=342, Percent_Identity=21.3450292397661, Blast_Score=77, Evalue=3e-14,
Organism=Homo sapiens, GI310110582, Length=342, Percent_Identity=21.3450292397661, Blast_Score=77, Evalue=3e-14,
Organism=Homo sapiens, GI118766330, Length=329, Percent_Identity=22.7963525835866, Blast_Score=76, Evalue=6e-14,
Organism=Homo sapiens, GI118766328, Length=329, Percent_Identity=22.7963525835866, Blast_Score=76, Evalue=6e-14,
Organism=Homo sapiens, GI301336134, Length=407, Percent_Identity=22.6044226044226, Blast_Score=71, Evalue=2e-12,
Organism=Homo sapiens, GI83415184, Length=407, Percent_Identity=22.6044226044226, Blast_Score=71, Evalue=2e-12,
Organism=Homo sapiens, GI170784867, Length=226, Percent_Identity=25.2212389380531, Blast_Score=69, Evalue=1e-11,
Organism=Homo sapiens, GI25952122, Length=327, Percent_Identity=23.2415902140673, Blast_Score=68, Evalue=2e-11,
Organism=Homo sapiens, GI167466177, Length=220, Percent_Identity=24.0909090909091, Blast_Score=68, Evalue=2e-11,
Organism=Homo sapiens, GI167466175, Length=220, Percent_Identity=24.0909090909091, Blast_Score=67, Evalue=2e-11,
Organism=Homo sapiens, GI22749211, Length=271, Percent_Identity=27.3062730627306, Blast_Score=67, Evalue=3e-11,
Organism=Caenorhabditis elegans, GI115532692, Length=389, Percent_Identity=27.7634961439589, Blast_Score=124, Evalue=1e-28,
Organism=Caenorhabditis elegans, GI115532690, Length=389, Percent_Identity=27.7634961439589, Blast_Score=124, Evalue=1e-28,
Organism=Saccharomyces cerevisiae, GI6319387, Length=248, Percent_Identity=26.2096774193548, Blast_Score=75, Evalue=2e-14,
Organism=Drosophila melanogaster, GI17647755, Length=392, Percent_Identity=26.2755102040816, Blast_Score=116, Evalue=3e-26,
Organism=Drosophila melanogaster, GI24585827, Length=392, Percent_Identity=26.2755102040816, Blast_Score=116, Evalue=3e-26,
Organism=Drosophila melanogaster, GI24585829, Length=392, Percent_Identity=26.2755102040816, Blast_Score=116, Evalue=3e-26,
Organism=Drosophila melanogaster, GI24647123, Length=261, Percent_Identity=28.735632183908, Blast_Score=83, Evalue=3e-16,
Organism=Drosophila melanogaster, GI24656717, Length=364, Percent_Identity=25.5494505494505, Blast_Score=72, Evalue=1e-12,
Organism=Drosophila melanogaster, GI18110006, Length=364, Percent_Identity=25.5494505494505, Blast_Score=72, Evalue=1e-12,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR001440
- InterPro:   IPR013026
- InterPro:   IPR011990
- InterPro:   IPR019734 [H]

Pfam domain/function: PF00515 TPR_1 [H]

EC number: NA

Molecular weight: Translated: 52848; Mature: 52717

Theoretical pI: Translated: 3.96; Mature: 3.96

Prosite motif: PS50005 TPR ; PS50293 TPR_REGION

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.3 %Cys     (Translated Protein)
1.5 %Met     (Translated Protein)
2.8 %Cys+Met (Translated Protein)
1.3 %Cys     (Mature Protein)
1.3 %Met     (Mature Protein)
2.6 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSLLDFFDDNLNPSEGFFPDRPEGASDPDSIHDPEELLDLIIQLNEEGLHETSLVAARRL
CCCHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHCCCCCHHHHHHHHHHH
EELAPYNAETWFHLGNSLTLNGLFDEALEAFQRAVLLSPADNEMALNLALAYFNTGRLDE
HHHCCCCCCHHEECCCCEEEHHHHHHHHHHHHHHHHCCCCCCCHHHEEEHHHHCCCCHHH
ALEEIERVVSDSTIARDICFYRGLILQRLERFEEAEKNFEQTLQLDPEFGEAWYELAYSQ
HHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHH
DILGKLDNSLVAYEKAIDLDPYNINAWYNKGLVLSKLKRYPEALEAYDMALVISEDFSSA
HHHHHHCCHHHHHHHHCCCCCCCCCHHHCCCHHHHHHHHHHHHHHHHHHHEEEECHHHHH
WYNRANVLAITGRIEDAAESYTKTLEIEPDDINALYNLGIAREELEQYSEAIACYKRCIE
HHCCCCEEEEECCCHHHHHHHHHEEECCCCHHHHHHHCCCCHHHHHHHHHHHHHHHHHHH
LNPEFADAWFALACCFEALENYEASLDAIGHALVEMPECIEYLLLKAEIEYNLGRLDQSL
CCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
KTYEKIIPLDPDSPQIWLDYAMVLREAGAMDASIRALEESISLQPLSAEAHFEIAATYFA
HHHHHCCCCCCCCCHHHHHHHHHHHHHCCCHHHHHHHHHHCCCCCCCCCCHHEEEEEEEE
MGDNQSTLKALSKAFKIDPDKKQLFQSVFPELYQQDAVRRLLEIS
ECCCHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHCCC
>Mature Secondary Structure 
SLLDFFDDNLNPSEGFFPDRPEGASDPDSIHDPEELLDLIIQLNEEGLHETSLVAARRL
CCHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHCCCCCHHHHHHHHHHH
EELAPYNAETWFHLGNSLTLNGLFDEALEAFQRAVLLSPADNEMALNLALAYFNTGRLDE
HHHCCCCCCHHEECCCCEEEHHHHHHHHHHHHHHHHCCCCCCCHHHEEEHHHHCCCCHHH
ALEEIERVVSDSTIARDICFYRGLILQRLERFEEAEKNFEQTLQLDPEFGEAWYELAYSQ
HHHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHH
DILGKLDNSLVAYEKAIDLDPYNINAWYNKGLVLSKLKRYPEALEAYDMALVISEDFSSA
HHHHHHCCHHHHHHHHCCCCCCCCCHHHCCCHHHHHHHHHHHHHHHHHHHEEEECHHHHH
WYNRANVLAITGRIEDAAESYTKTLEIEPDDINALYNLGIAREELEQYSEAIACYKRCIE
HHCCCCEEEEECCCHHHHHHHHHEEECCCCHHHHHHHCCCCHHHHHHHHHHHHHHHHHHH
LNPEFADAWFALACCFEALENYEASLDAIGHALVEMPECIEYLLLKAEIEYNLGRLDQSL
CCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
KTYEKIIPLDPDSPQIWLDYAMVLREAGAMDASIRALEESISLQPLSAEAHFEIAATYFA
HHHHHCCCCCCCCCHHHHHHHHHHHHHCCCHHHHHHHHHHCCCCCCCCCCHHEEEEEEEE
MGDNQSTLKALSKAFKIDPDKKQLFQSVFPELYQQDAVRRLLEIS
ECCCHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 8688087 [H]