Definition Chlorobium tepidum TLS, complete genome.
Accession NC_002932
Length 2,154,946

Click here to switch to the map view.

The map label for this gene is 21674344

Identifier: 21674344

GI number: 21674344

Start: 1423776

End: 1426289

Strand: Reverse

Name: 21674344

Synonym: CT1524

Alternate gene names: NA

Gene position: 1426289-1423776 (Counterclockwise)

Preceding gene: 21674345

Following gene: 21674343

Centisome position: 66.19

GC content: 59.35

Gene sequence:

>2514_bases
ATGACGAAAGGAGGGCGGCACCGGTTCACTGGTGCCACCCTCTCGTTTAACGTGATGCACTTGATTGTAAGATCGGAAAA
TAGAGTTCCGGATGAACTCCGGACTCAGCATACAACAACTATCAAATCAACAATACTGATGACTGAAATGACGACTCCGC
TTTCCCCTCGCGAACTCGATCTGATGAACGCTTACTGGCGAGCGGCGAACTACCTTTCCGTCGGCCAGATTTATCTGATG
GACAATCCACTCCTGAAAGAGCCGCTCTCCAAAGAACATATCAAGCCCCGCCTGCTCGGCCACTGGGGCACCACTCCCGG
TCTCAATTTCCTTTACGTGCACCTGAACCGCATCATCCGCAACCGCGATCTTGACATTATCTATATCGCCGGGCCGGGAC
ATGGCGGGCCTGCGCTGGTGGCGAACGTATGGCTGGAGGGTACCTACAGTGAGTACTATCCCGATGTGTCGTTCGACGAG
GCGGGCATGAAGCGGCTGTTCCGGCAGTTCTCGTTTCCGGGCGGTATTCCGAGCCACGTGGCTCCCGCAACGCCGGGATC
GATCCATGAGGGCGGAGAGCTGGGCTATGCGTTGTCGCACGCTTACGGCGCGGTGTTCGACAATCCCGATCTTGTCGCAG
CCTGTGTCATCGGCGATGGCGAGGCAGAGACGGGGCCACTGGCGACGGCGTGGCACAGCAACAAGTTCCTGAACCCGAAG
CGCGACGGGGCGGTGCTGCCGGTTCTGCACCTGAACGGCTACAAGATCGCCAACCCAACGGTGCTGGCGCGCATTTCGCA
CGAGGAGCTGGAGCAGCTCATGATTGGCTACGGCTACAAACCGTACTTCGTTGAGGGGGATGACCCGGCGACGATGCACC
AGATGATGGCGGCGACGATGGACCGCTGCTTCGATGAGATCGCCGAAATCCAGCGCCGGGCGAGGGTCGATGGCGTGACC
GAGCGACCGATGTGGCCGATGATCGTGTTTCGCTCTCCGAAAGGGTGGACGGGGCCGAAGGTGGTTGACGGCAAACCCGC
CGAGGGGAGCTGGCGTTCACACCAGGTGCCGTTCAGCACGGTGCGAGACAATCCGGAGCACATGGCGCTGCTCGAAACGT
GGCTGAAAAGCTACCGTGCCGAAGAGCTGTTCACAGCGGATGGCGTTCTTCTTCCTGAGTTGCAGGAGCTGGCTCCGCGT
GGCAAGAAGCGCATGGGCGATATTCCACACGCCAACGGCGGCCTGTTGCTCAAGGAGTTGCGGATGCCGGACTTTCGGGA
ATATGGAATCGATGTACCGAAGCCCGGATCGGTGGAGGCCGAAGCGCCTAAGCCGATGGCCCGCTTTCTGCGCGACATCA
TGAAGATGAACGAGAAGGCGGCCAACTTCCGCGTTTTCGGGCCGGACGAGACCGCATCAAACCGCCTTGGCGAGCTGTTC
GAAGAGACCGACCGCACGTGGATGGCCGGGATGCTGCCGACCGACGATCATCTGTCGCGCGATGGCCGCGTGATGGAAAT
TCTCTCGGAGCACACCTGCCAGGGGTGGCTTGAAGGATACCTTTTGACCGGACGCCACGGCTTCTTCTCATGCTACGAGG
CGTTCATCCACATCATCGACTCGATGTTCAACCAGCACGCCAAGTGGCTGAAGGTGACTGGTGCCGAAATTCCCTGGCGC
CGGCCCATCGCTTCGCTGAACTATTTCCTGACTTCGCACGTGTGGCGGCAGGATCACAACGGCTTTTCGCATCAGGATCC
CGGTTTTATTGACCATGTGGTCAACAAGAAGTCGAGCGTGATTCGTGTTTATCTGCCGCCAGACGCCAATTCGCTGCTGT
CGGTCACAAACCATTGCCTGCGCTCCCGCAATTACATCAATGTGATTGTGGCGGGTAAACAGCCAGCGTGGCAGTGGCTT
GACATGGAGTCCGCCGTGCGGCACTGTACCAGCGGCATCGGCATCTGGGAGTGGGCCTCGAATGACGCGAATGAGGGCGA
GCCGGACGTGGTGATGGCTTGTGCGGGCGACGTGCCGACGCTTGAAACGCTGGCCGCCGTCAAGATTCTGCGCAAACTCG
CGCCGGAGTTGAAGATCAGGGTGGTCAACGTGGTCGATCTCATGACTCTCCAGCCGAAAGAGGAGCACCCGCACGGCCTT
GCCGATCGCGATTTCGACGACATGTTTACTACAGACAAGCCGATCATCTTCGCCTATCACGGTTACCCGTGGCTGATCCA
CCGGCTGACCTACCGCCGCACGAACCACCACAACCTGCACGTGCGTGGCTACAAGGAGGAGGGCACCACGACGACGCCGT
TCGACATGGTGGTGATGAACGAGCTCGACCGCTTCCACCTGGTAGCCGACGTAGCCAACCGCGTGGAGAGCCTCAGGCCA
CAAGCTGCCTACATCAAACAATACGTCCGCGACCGCCTGATCGAGCACAAGGAGTACATCACGAAATATGGCGAGGATAT
GCCGGAAGTGAGGGATTGGCGCTGGGAGGATTGA

Upstream 100 bases:

>100_bases
TGAAACCAACGAAGAGGTGACGATTGTCAGAGAGACAAGACGTGTGCTCGAAAATGGTTGATGTGATGCCAATATGGTGT
GGTTACCGGTTTGGCATTGA

Downstream 100 bases:

>100_bases
TTTGATGTGATATGAAAAGAAAAGCGGCCTTTGACAGGCCGCTTTTTGTGTTGGAGGTAGGGAGAGTCAGATTGTCAGCT
TAACCTGTTTTGCCAATATC

Product: putative phosphoketolase

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 837; Mature: 836

Protein sequence:

>837_residues
MTKGGRHRFTGATLSFNVMHLIVRSENRVPDELRTQHTTTIKSTILMTEMTTPLSPRELDLMNAYWRAANYLSVGQIYLM
DNPLLKEPLSKEHIKPRLLGHWGTTPGLNFLYVHLNRIIRNRDLDIIYIAGPGHGGPALVANVWLEGTYSEYYPDVSFDE
AGMKRLFRQFSFPGGIPSHVAPATPGSIHEGGELGYALSHAYGAVFDNPDLVAACVIGDGEAETGPLATAWHSNKFLNPK
RDGAVLPVLHLNGYKIANPTVLARISHEELEQLMIGYGYKPYFVEGDDPATMHQMMAATMDRCFDEIAEIQRRARVDGVT
ERPMWPMIVFRSPKGWTGPKVVDGKPAEGSWRSHQVPFSTVRDNPEHMALLETWLKSYRAEELFTADGVLLPELQELAPR
GKKRMGDIPHANGGLLLKELRMPDFREYGIDVPKPGSVEAEAPKPMARFLRDIMKMNEKAANFRVFGPDETASNRLGELF
EETDRTWMAGMLPTDDHLSRDGRVMEILSEHTCQGWLEGYLLTGRHGFFSCYEAFIHIIDSMFNQHAKWLKVTGAEIPWR
RPIASLNYFLTSHVWRQDHNGFSHQDPGFIDHVVNKKSSVIRVYLPPDANSLLSVTNHCLRSRNYINVIVAGKQPAWQWL
DMESAVRHCTSGIGIWEWASNDANEGEPDVVMACAGDVPTLETLAAVKILRKLAPELKIRVVNVVDLMTLQPKEEHPHGL
ADRDFDDMFTTDKPIIFAYHGYPWLIHRLTYRRTNHHNLHVRGYKEEGTTTTPFDMVVMNELDRFHLVADVANRVESLRP
QAAYIKQYVRDRLIEHKEYITKYGEDMPEVRDWRWED

Sequences:

>Translated_837_residues
MTKGGRHRFTGATLSFNVMHLIVRSENRVPDELRTQHTTTIKSTILMTEMTTPLSPRELDLMNAYWRAANYLSVGQIYLM
DNPLLKEPLSKEHIKPRLLGHWGTTPGLNFLYVHLNRIIRNRDLDIIYIAGPGHGGPALVANVWLEGTYSEYYPDVSFDE
AGMKRLFRQFSFPGGIPSHVAPATPGSIHEGGELGYALSHAYGAVFDNPDLVAACVIGDGEAETGPLATAWHSNKFLNPK
RDGAVLPVLHLNGYKIANPTVLARISHEELEQLMIGYGYKPYFVEGDDPATMHQMMAATMDRCFDEIAEIQRRARVDGVT
ERPMWPMIVFRSPKGWTGPKVVDGKPAEGSWRSHQVPFSTVRDNPEHMALLETWLKSYRAEELFTADGVLLPELQELAPR
GKKRMGDIPHANGGLLLKELRMPDFREYGIDVPKPGSVEAEAPKPMARFLRDIMKMNEKAANFRVFGPDETASNRLGELF
EETDRTWMAGMLPTDDHLSRDGRVMEILSEHTCQGWLEGYLLTGRHGFFSCYEAFIHIIDSMFNQHAKWLKVTGAEIPWR
RPIASLNYFLTSHVWRQDHNGFSHQDPGFIDHVVNKKSSVIRVYLPPDANSLLSVTNHCLRSRNYINVIVAGKQPAWQWL
DMESAVRHCTSGIGIWEWASNDANEGEPDVVMACAGDVPTLETLAAVKILRKLAPELKIRVVNVVDLMTLQPKEEHPHGL
ADRDFDDMFTTDKPIIFAYHGYPWLIHRLTYRRTNHHNLHVRGYKEEGTTTTPFDMVVMNELDRFHLVADVANRVESLRP
QAAYIKQYVRDRLIEHKEYITKYGEDMPEVRDWRWED
>Mature_836_residues
TKGGRHRFTGATLSFNVMHLIVRSENRVPDELRTQHTTTIKSTILMTEMTTPLSPRELDLMNAYWRAANYLSVGQIYLMD
NPLLKEPLSKEHIKPRLLGHWGTTPGLNFLYVHLNRIIRNRDLDIIYIAGPGHGGPALVANVWLEGTYSEYYPDVSFDEA
GMKRLFRQFSFPGGIPSHVAPATPGSIHEGGELGYALSHAYGAVFDNPDLVAACVIGDGEAETGPLATAWHSNKFLNPKR
DGAVLPVLHLNGYKIANPTVLARISHEELEQLMIGYGYKPYFVEGDDPATMHQMMAATMDRCFDEIAEIQRRARVDGVTE
RPMWPMIVFRSPKGWTGPKVVDGKPAEGSWRSHQVPFSTVRDNPEHMALLETWLKSYRAEELFTADGVLLPELQELAPRG
KKRMGDIPHANGGLLLKELRMPDFREYGIDVPKPGSVEAEAPKPMARFLRDIMKMNEKAANFRVFGPDETASNRLGELFE
ETDRTWMAGMLPTDDHLSRDGRVMEILSEHTCQGWLEGYLLTGRHGFFSCYEAFIHIIDSMFNQHAKWLKVTGAEIPWRR
PIASLNYFLTSHVWRQDHNGFSHQDPGFIDHVVNKKSSVIRVYLPPDANSLLSVTNHCLRSRNYINVIVAGKQPAWQWLD
MESAVRHCTSGIGIWEWASNDANEGEPDVVMACAGDVPTLETLAAVKILRKLAPELKIRVVNVVDLMTLQPKEEHPHGLA
DRDFDDMFTTDKPIIFAYHGYPWLIHRLTYRRTNHHNLHVRGYKEEGTTTTPFDMVVMNELDRFHLVADVANRVESLRPQ
AAYIKQYVRDRLIEHKEYITKYGEDMPEVRDWRWED

Specific function: Unknown

COG id: COG3957

COG function: function code G; Phosphoketolase

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: NA

Operon status: Not Known

Operon components: None

Similarity: Belongs to the XFP family [H]

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR009014
- InterPro:   IPR005593
- InterPro:   IPR018969
- InterPro:   IPR019790
- InterPro:   IPR018970
- InterPro:   IPR019789 [H]

Pfam domain/function: PF03894 XFP; PF09363 XFP_C; PF09364 XFP_N [H]

EC number: NA

Molecular weight: Translated: 95260; Mature: 95129

Theoretical pI: Translated: 6.63; Mature: 6.63

Prosite motif: PS60002 PHOSPHOKETOLASE_1 ; PS60003 PHOSPHOKETOLASE_2

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.8 %Cys     (Translated Protein)
3.7 %Met     (Translated Protein)
4.5 %Cys+Met (Translated Protein)
0.8 %Cys     (Mature Protein)
3.6 %Met     (Mature Protein)
4.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MTKGGRHRFTGATLSFNVMHLIVRSENRVPDELRTQHTTTIKSTILMTEMTTPLSPRELD
CCCCCCEEECCCEEEHEEEEEEEECCCCCCHHHHHHHHHHHHHHEEEEECCCCCCCCHHH
LMNAYWRAANYLSVGQIYLMDNPLLKEPLSKEHIKPRLLGHWGTTPGLNFLYVHLNRIIR
HHHHHHHHCCCEECCEEEEECCCHHHCCCCHHCCCCCEEECCCCCCCCHHHHHHHHHHHH
NRDLDIIYIAGPGHGGPALVANVWLEGTYSEYYPDVSFDEAGMKRLFRQFSFPGGIPSHV
CCCCCEEEEECCCCCCCEEEEEEEECCCHHHHCCCCCCCHHHHHHHHHHHCCCCCCCCCC
APATPGSIHEGGELGYALSHAYGAVFDNPDLVAACVIGDGEAETGPLATAWHSNKFLNPK
CCCCCCCCCCCCCCCHHHHHHHHCEECCCCEEEEEEEECCCCCCCCEEEEECCCCCCCCC
RDGAVLPVLHLNGYKIANPTVLARISHEELEQLMIGYGYKPYFVEGDDPATMHQMMAATM
CCCCEEEEEEECCEEECCCEEEEEECHHHHHHHHHHCCCCCEEEECCCHHHHHHHHHHHH
DRCFDEIAEIQRRARVDGVTERPMWPMIVFRSPKGWTGPKVVDGKPAEGSWRSHQVPFST
HHHHHHHHHHHHHHHCCCCCCCCCCCEEEEECCCCCCCCEEECCCCCCCCCCCCCCCHHH
VRDNPEHMALLETWLKSYRAEELFTADGVLLPELQELAPRGKKRMGDIPHANGGLLLKEL
HCCCHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHCCCHHHHCCCCCCCCCCEEEEEC
RMPDFREYGIDVPKPGSVEAEAPKPMARFLRDIMKMNEKAANFRVFGPDETASNRLGELF
CCCCHHHHCCCCCCCCCCCCCCCCHHHHHHHHHHHHCHHHCCEEEECCCCHHHHHHHHHH
EETDRTWMAGMLPTDDHLSRDGRVMEILSEHTCQGWLEGYLLTGRHGFFSCYEAFIHIID
HHHCCCEEECCCCCHHHCCCCCHHHHHHHHHHHHHHHCCEEEECCCHHHHHHHHHHHHHH
SMFNQHAKWLKVTGAEIPWRRPIASLNYFLTSHVWRQDHNGFSHQDPGFIDHVVNKKSSV
HHHHHCCCEEEEECCCCCCCCCHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHCCCCCE
IRVYLPPDANSLLSVTNHCLRSRNYINVIVAGKQPAWQWLDMESAVRHCTSGIGIWEWAS
EEEEECCCCHHHHHHHHHHHHCCCEEEEEEECCCCCHHHCCHHHHHHHHHCCCCEEEECC
NDANEGEPDVVMACAGDVPTLETLAAVKILRKLAPELKIRVVNVVDLMTLQPKEEHPHGL
CCCCCCCCCEEEEECCCCCHHHHHHHHHHHHHHCCHHEEEEEEEEEHEECCCCCCCCCCC
ADRDFDDMFTTDKPIIFAYHGYPWLIHRLTYRRTNHHNLHVRGYKEEGTTTTPFDMVVMN
CCCCCHHHHCCCCCEEEEECCCHHHHHHHHHHCCCCCEEEEEEECCCCCCCCCHHHHHHH
ELDRFHLVADVANRVESLRPQAAYIKQYVRDRLIEHKEYITKYGEDMPEVRDWRWED
HHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHCCCCCCC
>Mature Secondary Structure 
TKGGRHRFTGATLSFNVMHLIVRSENRVPDELRTQHTTTIKSTILMTEMTTPLSPRELD
CCCCCEEECCCEEEHEEEEEEEECCCCCCHHHHHHHHHHHHHHEEEEECCCCCCCCHHH
LMNAYWRAANYLSVGQIYLMDNPLLKEPLSKEHIKPRLLGHWGTTPGLNFLYVHLNRIIR
HHHHHHHHCCCEECCEEEEECCCHHHCCCCHHCCCCCEEECCCCCCCCHHHHHHHHHHHH
NRDLDIIYIAGPGHGGPALVANVWLEGTYSEYYPDVSFDEAGMKRLFRQFSFPGGIPSHV
CCCCCEEEEECCCCCCCEEEEEEEECCCHHHHCCCCCCCHHHHHHHHHHHCCCCCCCCCC
APATPGSIHEGGELGYALSHAYGAVFDNPDLVAACVIGDGEAETGPLATAWHSNKFLNPK
CCCCCCCCCCCCCCCHHHHHHHHCEECCCCEEEEEEEECCCCCCCCEEEEECCCCCCCCC
RDGAVLPVLHLNGYKIANPTVLARISHEELEQLMIGYGYKPYFVEGDDPATMHQMMAATM
CCCCEEEEEEECCEEECCCEEEEEECHHHHHHHHHHCCCCCEEEECCCHHHHHHHHHHHH
DRCFDEIAEIQRRARVDGVTERPMWPMIVFRSPKGWTGPKVVDGKPAEGSWRSHQVPFST
HHHHHHHHHHHHHHHCCCCCCCCCCCEEEEECCCCCCCCEEECCCCCCCCCCCCCCCHHH
VRDNPEHMALLETWLKSYRAEELFTADGVLLPELQELAPRGKKRMGDIPHANGGLLLKEL
HCCCHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHCCCHHHHCCCCCCCCCCEEEEEC
RMPDFREYGIDVPKPGSVEAEAPKPMARFLRDIMKMNEKAANFRVFGPDETASNRLGELF
CCCCHHHHCCCCCCCCCCCCCCCCHHHHHHHHHHHHCHHHCCEEEECCCCHHHHHHHHHH
EETDRTWMAGMLPTDDHLSRDGRVMEILSEHTCQGWLEGYLLTGRHGFFSCYEAFIHIID
HHHCCCEEECCCCCHHHCCCCCHHHHHHHHHHHHHHHCCEEEECCCHHHHHHHHHHHHHH
SMFNQHAKWLKVTGAEIPWRRPIASLNYFLTSHVWRQDHNGFSHQDPGFIDHVVNKKSSV
HHHHHCCCEEEEECCCCCCCCCHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHCCCCCE
IRVYLPPDANSLLSVTNHCLRSRNYINVIVAGKQPAWQWLDMESAVRHCTSGIGIWEWAS
EEEEECCCCHHHHHHHHHHHHCCCEEEEEEECCCCCHHHCCHHHHHHHHHCCCCEEEECC
NDANEGEPDVVMACAGDVPTLETLAAVKILRKLAPELKIRVVNVVDLMTLQPKEEHPHGL
CCCCCCCCCEEEEECCCCCHHHHHHHHHHHHHHCCHHEEEEEEEEEHEECCCCCCCCCCC
ADRDFDDMFTTDKPIIFAYHGYPWLIHRLTYRRTNHHNLHVRGYKEEGTTTTPFDMVVMN
CCCCCHHHHCCCCCEEEEECCCHHHHHHHHHHCCCCCEEEEEEECCCCCCCCCHHHHHHH
ELDRFHLVADVANRVESLRPQAAYIKQYVRDRLIEHKEYITKYGEDMPEVRDWRWED
HHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCCHHCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 12093901 [H]