Definition Chlorobium tepidum TLS, complete genome.
Accession NC_002932
Length 2,154,946

Click here to switch to the map view.

The map label for this gene is ytfL [C]

Identifier: 21674811

GI number: 21674811

Start: 1896470

End: 1897816

Strand: Direct

Name: ytfL [C]

Synonym: CT2000

Alternate gene names: 21674811

Gene position: 1896470-1897816 (Clockwise)

Preceding gene: 21674796

Following gene: 21674812

Centisome position: 88.01

GC content: 57.83

Gene sequence:

>1347_bases
ATGAGTCCCCAAAGCGCAGAAGCGATCATCATCATCCTGCTGATCCTCTTCGAAGGAGTCCTCTCTCTGGCGGAGTTCGC
CATCATCTCTTCGAGCCCGGCCCGCCTGCGTGAGCTGCGGGAAGCGGGATACCCATCGGCGTCTGTCGCGCTGAAACTTC
AGGATAATGCCGCCCGGTTCCTGTCGTCCATCAAGGTCACAGCCATTCTGATCACCACGCTGACGAGCGTTTTAGGCGGA
CTTTTTCTTGCCGAACCACTTGCTGCGCTGTTCAGCCACCTCGCCATACTTGAGCCCTACAGCCATCCTCTTGCGCTCAC
GGTCGTCATTGCATCACTCGCTTACCTGACTCACGTGATCGGCGGACTGCTTCCGAAAAAATTCGCCCTGCGGCATCCAG
AAGCAATCGCCGTGAGGATTGCCGGATTCATGAACAAACTTTGCACCATCAGCTCCCCTGCGGTGCTGCTTGCTGACGCC
TCGGCAGCGCTGCTGCTCCGCGCATTCGGCATCGAGGCGAACGAAAAACCCCAGGTCAGCGACGAAGATGTGATGCTCAT
GATCCGGCAGGGCGCCAAGAAGGGGGTGTTCGAATCGGTCGAGTACGAGATGATCTCAAGAATTTTCCGCATGAGCGACA
AGCGAGCCAGCGCCCTGATGACACCGCGCAACGAGATCGAGTGGCTCGATCTGGAGAGGCCGGACGAAGAACTGGTTGCA
CGGATCAAGGCGAGCGGCCGCTCACGCTTTCCGGTAGCAAAGGGCAGCCTCGACGAGCTTCAGGGCGTGGTAAGGTCTCT
CGATCTGGTCAACTTCAGCCTCTCGTCAAAAGGCAGCATCCGGGAGGCGATCCGGGCATCAATGAAGCCGCCGCTCTTCG
TGCCCGAATCGGTACCAGCCTTTCATGTGCTCGAACTCTTCAAAAAAAACCGCGCGCACATGGCGCTGGTGATCGACGAA
CACGGTTCGGTACAGGGAGCCATCACCCTCACCGATGTACTCGAAAGCATCGTCGGCGACGTGCCGGCGGACGACATGGA
GGGCGACCAGAAAACCATCGTGCGCCGGAGCGAGCGCACCTGGCTGGTCGATGGCATGGTGCCGGTCGATGAGTTTCTCA
CGGCCTTCAACCTCGATGCTGAGAAGTTTTTCGAGGAGAACGAGCCCCGTTACGATACGATGGGCGGCTTCATGATGACC
CGCCTCGGCGAGGTTCCCTCGGTCTCCGATACGGTCAAATGGGGCGGACTCACCTTCAAGGTGATCAAAATGAACGGAAA
GCGTGTCGGACGCATTCTTGTTGAACAGGAGGCAAAAAACGCCGAGAAAAAAATAACCAAACTATAG

Upstream 100 bases:

>100_bases
TTCAATGAAACGTTCAAAACACCAAGCCGGTTATGTGAAGGTATTGCTGTATCTTGAGACATATCAAAGCATAACATGCC
GGGTCACTGAACCTTAATTT

Downstream 100 bases:

>100_bases
AAAGCAATGATCGAAGAAGGTAAAATCGCCCCGGATTTCACGCTTCCCGACAGCACGGGCAAAATGGTTTCCCTGTCGGA
GTTCAAAGGCCGCAAGGTGC

Product: CBS domain-containing protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 448; Mature: 447

Protein sequence:

>448_residues
MSPQSAEAIIIILLILFEGVLSLAEFAIISSSPARLRELREAGYPSASVALKLQDNAARFLSSIKVTAILITTLTSVLGG
LFLAEPLAALFSHLAILEPYSHPLALTVVIASLAYLTHVIGGLLPKKFALRHPEAIAVRIAGFMNKLCTISSPAVLLADA
SAALLLRAFGIEANEKPQVSDEDVMLMIRQGAKKGVFESVEYEMISRIFRMSDKRASALMTPRNEIEWLDLERPDEELVA
RIKASGRSRFPVAKGSLDELQGVVRSLDLVNFSLSSKGSIREAIRASMKPPLFVPESVPAFHVLELFKKNRAHMALVIDE
HGSVQGAITLTDVLESIVGDVPADDMEGDQKTIVRRSERTWLVDGMVPVDEFLTAFNLDAEKFFEENEPRYDTMGGFMMT
RLGEVPSVSDTVKWGGLTFKVIKMNGKRVGRILVEQEAKNAEKKITKL

Sequences:

>Translated_448_residues
MSPQSAEAIIIILLILFEGVLSLAEFAIISSSPARLRELREAGYPSASVALKLQDNAARFLSSIKVTAILITTLTSVLGG
LFLAEPLAALFSHLAILEPYSHPLALTVVIASLAYLTHVIGGLLPKKFALRHPEAIAVRIAGFMNKLCTISSPAVLLADA
SAALLLRAFGIEANEKPQVSDEDVMLMIRQGAKKGVFESVEYEMISRIFRMSDKRASALMTPRNEIEWLDLERPDEELVA
RIKASGRSRFPVAKGSLDELQGVVRSLDLVNFSLSSKGSIREAIRASMKPPLFVPESVPAFHVLELFKKNRAHMALVIDE
HGSVQGAITLTDVLESIVGDVPADDMEGDQKTIVRRSERTWLVDGMVPVDEFLTAFNLDAEKFFEENEPRYDTMGGFMMT
RLGEVPSVSDTVKWGGLTFKVIKMNGKRVGRILVEQEAKNAEKKITKL
>Mature_447_residues
SPQSAEAIIIILLILFEGVLSLAEFAIISSSPARLRELREAGYPSASVALKLQDNAARFLSSIKVTAILITTLTSVLGGL
FLAEPLAALFSHLAILEPYSHPLALTVVIASLAYLTHVIGGLLPKKFALRHPEAIAVRIAGFMNKLCTISSPAVLLADAS
AALLLRAFGIEANEKPQVSDEDVMLMIRQGAKKGVFESVEYEMISRIFRMSDKRASALMTPRNEIEWLDLERPDEELVAR
IKASGRSRFPVAKGSLDELQGVVRSLDLVNFSLSSKGSIREAIRASMKPPLFVPESVPAFHVLELFKKNRAHMALVIDEH
GSVQGAITLTDVLESIVGDVPADDMEGDQKTIVRRSERTWLVDGMVPVDEFLTAFNLDAEKFFEENEPRYDTMGGFMMTR
LGEVPSVSDTVKWGGLTFKVIKMNGKRVGRILVEQEAKNAEKKITKL

Specific function: Unknown

COG id: COG1253

COG function: function code R; Hemolysins and related proteins containing CBS domains

Gene ontology:

Cell location: Cell membrane; Multi-pass membrane protein (Potential) [H]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 2 CBS domains [H]

Homologues:

Organism=Homo sapiens, GI310128564, Length=383, Percent_Identity=27.154046997389, Blast_Score=142, Evalue=9e-34,
Organism=Escherichia coli, GI1790664, Length=426, Percent_Identity=27.4647887323944, Blast_Score=197, Evalue=9e-52,
Organism=Escherichia coli, GI87082033, Length=358, Percent_Identity=27.6536312849162, Blast_Score=139, Evalue=4e-34,
Organism=Escherichia coli, GI1786879, Length=260, Percent_Identity=28.8461538461538, Blast_Score=112, Evalue=3e-26,
Organism=Escherichia coli, GI1788119, Length=355, Percent_Identity=27.887323943662, Blast_Score=111, Evalue=8e-26,
Organism=Escherichia coli, GI145693175, Length=416, Percent_Identity=22.1153846153846, Blast_Score=102, Evalue=4e-23,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR016169
- InterPro:   IPR000644
- InterPro:   IPR002550
- InterPro:   IPR005170 [H]

Pfam domain/function: PF00571 CBS; PF03471 CorC_HlyC; PF01595 DUF21 [H]

EC number: NA

Molecular weight: Translated: 49187; Mature: 49056

Theoretical pI: Translated: 6.43; Mature: 6.43

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.2 %Cys     (Translated Protein)
3.3 %Met     (Translated Protein)
3.6 %Cys+Met (Translated Protein)
0.2 %Cys     (Mature Protein)
3.1 %Met     (Mature Protein)
3.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MSPQSAEAIIIILLILFEGVLSLAEFAIISSSPARLRELREAGYPSASVALKLQDNAARF
CCCCHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHCCCCCCEEEEEECCHHHHH
LSSIKVTAILITTLTSVLGGLFLAEPLAALFSHLAILEPYSHPLALTVVIASLAYLTHVI
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHH
GGLLPKKFALRHPEAIAVRIAGFMNKLCTISSPAVLLADASAALLLRAFGIEANEKPQVS
HHHHHHHHHHCCCHHHHHHHHHHHHHHHCCCCCEEEEECCHHHHHHHHHCCCCCCCCCCC
DEDVMLMIRQGAKKGVFESVEYEMISRIFRMSDKRASALMTPRNEIEWLDLERPDEELVA
CHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHCCHHHHHHCCCCCCCCEECCCCCHHHHHH
RIKASGRSRFPVAKGSLDELQGVVRSLDLVNFSLSSKGSIREAIRASMKPPLFVPESVPA
HHHHCCCCCCCCCCCCHHHHHHHHHHHHHHEECCCCCCHHHHHHHHHCCCCEECCCCCCH
FHVLELFKKNRAHMALVIDEHGSVQGAITLTDVLESIVGDVPADDMEGDQKTIVRRSERT
HHHHHHHHCCCCEEEEEEECCCCCEEEEEHHHHHHHHHCCCCCCCCCCCHHHHHHHCCCE
WLVDGMVPVDEFLTAFNLDAEKFFEENEPRYDTMGGFMMTRLGEVPSVSDTVKWGGLTFK
EEECCCCCHHHHHHHHCCCHHHHHHCCCCCCHHHHHHHHHHHCCCCCCCCCEEECCEEEE
VIKMNGKRVGRILVEQEAKNAEKKITKL
EEEECCCHHHHHHHHHHHHHHHHHHHCC
>Mature Secondary Structure 
SPQSAEAIIIILLILFEGVLSLAEFAIISSSPARLRELREAGYPSASVALKLQDNAARF
CCCHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHCCCCCCEEEEEECCHHHHH
LSSIKVTAILITTLTSVLGGLFLAEPLAALFSHLAILEPYSHPLALTVVIASLAYLTHVI
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHH
GGLLPKKFALRHPEAIAVRIAGFMNKLCTISSPAVLLADASAALLLRAFGIEANEKPQVS
HHHHHHHHHHCCCHHHHHHHHHHHHHHHCCCCCEEEEECCHHHHHHHHHCCCCCCCCCCC
DEDVMLMIRQGAKKGVFESVEYEMISRIFRMSDKRASALMTPRNEIEWLDLERPDEELVA
CHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHCCHHHHHHCCCCCCCCEECCCCCHHHHHH
RIKASGRSRFPVAKGSLDELQGVVRSLDLVNFSLSSKGSIREAIRASMKPPLFVPESVPA
HHHHCCCCCCCCCCCCHHHHHHHHHHHHHHEECCCCCCHHHHHHHHHCCCCEECCCCCCH
FHVLELFKKNRAHMALVIDEHGSVQGAITLTDVLESIVGDVPADDMEGDQKTIVRRSERT
HHHHHHHHCCCCEEEEEEECCCCCEEEEEHHHHHHHHHCCCCCCCCCCCHHHHHHHCCCE
WLVDGMVPVDEFLTAFNLDAEKFFEENEPRYDTMGGFMMTRLGEVPSVSDTVKWGGLTFK
EEECCCCCHHHHHHHHCCCHHHHHHCCCCCCHHHHHHHHHHHCCCCCCCCCEEECCEEEE
VIKMNGKRVGRILVEQEAKNAEKKITKL
EEEECCCHHHHHHHHHHHHHHHHHHHCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 6.0

TargetDB status: NA

Availability: NA

References: 8905231 [H]