Definition Mycobacterium tuberculosis F11, complete genome.
Accession NC_009565
Length 4,424,435

Click here to switch to the map view.

The map label for this gene is ychK [C]

Identifier: 148823760

GI number: 148823760

Start: 2897928

End: 2899679

Strand: Direct

Name: ychK [C]

Synonym: TBFG_12585

Alternate gene names: 148823760

Gene position: 2897928-2899679 (Clockwise)

Preceding gene: 148823759

Following gene: 148823761

Centisome position: 65.5

GC content: 64.61

Gene sequence:

>1752_bases
ATGACCACCGCGCGACGACGGCCCAAGCGGCGTGGTACCGATGCGCGAACCGCGCTGCGCAACGTTCCGATACTCGCCGA
TATCGACGACGAACAGCTCGAACGACTCGCAACCACCGTAGAACGCCGCCACGTGCCCGCTAACCAGTGGCTCTTTCATG
CCGGAGAACCAGCGGACTCCATCTATATCGTCGACTCGGGGCGGTTCGTCGCTGTTGCCCCAGAGGGACACGTATTTGCT
GAGATGGCATCCGGCGACTCGATCGGAGACCTGGGGGTGATCGCCGGGGCTGCCCGCTCAGCGGGAGTGCGAGCTCTGCG
AGACGGCGTGGTGTGGAGGATCGCCGCGGAGACGTTTACCGACATGCTCGAGGCAACCCCGCTACTGCAATCGGCGATGC
TGCGAGCGATGGCGAGAATGCTACGCCAGTCACGACCCGCCAAGACGGCTCGGCGTCCGCGGGTCATCGGCGTGGTATCG
AACGGGGACACCGCCGCGGCCCCGATGGTCGACGCGATCGCTACTTCACTGGACTCGCACGGTCGAACTGCCGTGATTGC
GCCGCCCGTCGAAACCACCTCCGCCGTTCAGGAGTACGACGAGCTCGTCGAGGCGTTCAGCGAAACCCTCGATCGCGCGG
AGCGAAGCAACGATTGGGTCTTGGTGGTCGCCGACCGAGGCGCCGGCGACCTGTGGCGGCACTACGTTAGCGCGCAAAGC
GACCGACTCGTGGTCCTGGTGGATCAACGGTATCCGCCGGATGCGGTCGATTCGCTTGCTACCCAACGGCCAGTGCACCT
GATCACATGTCTGGCAGAACCGGATCCAAGTTGGTGGGATCGGTTGGCGCCGGTTTCGCATCATCCGGCCAACTCCGACG
GCTTCGGTGCCCTTGCTCGCAGAATCGCCGGCCGATCGCTCGGCCTGGTGATGGCCGGTGGCGGAGCCCGGGGACTGGCG
CATTTCGGTGTTTACCAAGAGCTCACCGAAGCCGGCGTCGTCATCGATCGGTTTGGCGGAACAAGTTCGGGTGCAATCGC
TTCCGCAGCGTTCGCGCTGGGGATGGACGCCGGGGATGCGATCGCCGCGGCGCGAGAGTTCATCGCAGGAAGCGACCCAC
TCGGCGACTACACGATCCCAATATCCGCCCTCACGCGAGGTGGACGCGTCGATCGTCTGGTGCAGGGATTCTTCGGCAAC
ACGTTGATCGAACATCTGCCCAGAGGGTTCTTCTCCGTCTCCGCCGACATGATCACCGGCGATCAGATCATCCATCGGCG
GGGATCCGTCTCGGGCGCCGTGCGCGCATCGATCTCGATCCCCGGTCTCATCCCGCCAGTGCACAATGGCGAGCAGCTGC
TCGTCGACGGTGGGCTGTTGAACAATCTGCCGGCCAACGTGATGTGCGCCGATACCGATGGCGAAGTCATCTGCGTCGAC
CTCCGCCGAACGTTCGTGCCGTCGAAGGGCTTTGGCCTGCTGCCGCCAATCGTTACGCCGCCCGGGCTCCTCCGGCGGCT
TTTGACCGGCACGGATAACGCGCTACCACCGCTGCAAGAGACGTTGCTGCGCGCCTTCGACCTTGCCGCCTCCACCGCAA
ACCTGCGCGAGCTTCCTCGCGTTGCGGCCATCATCGAGCCCGACGTGTCGAAGATCGGAGTGTTGAACTTCAAGCAGATT
GATGCCGCCCTAGAGGCTGGGCGGATGGCAGCCCGTGCGGCTTTGCAAGCACAGCCGGACCTGGTGCGCTGA

Upstream 100 bases:

>100_bases
CGCTCTTCACAATGTCAGGCACTGCCGTGAGAAGTCCGCTACTCGATCGGGTGTATGTGAGCAGTCCTGGCATGGGCCGA
GATGCCAAGAGCCGCATCTC

Downstream 100 bases:

>100_bases
ACCCGACCAAGTGCCGCTACGGCCCACTCAGGTGTCCGGCACCGGGCGTACGCGCTGCGCCGGGCGGTCCGGTGTGATCT
CATCAGCAGCTATGAGCATC

Product: hypothetical protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 583; Mature: 582

Protein sequence:

>583_residues
MTTARRRPKRRGTDARTALRNVPILADIDDEQLERLATTVERRHVPANQWLFHAGEPADSIYIVDSGRFVAVAPEGHVFA
EMASGDSIGDLGVIAGAARSAGVRALRDGVVWRIAAETFTDMLEATPLLQSAMLRAMARMLRQSRPAKTARRPRVIGVVS
NGDTAAAPMVDAIATSLDSHGRTAVIAPPVETTSAVQEYDELVEAFSETLDRAERSNDWVLVVADRGAGDLWRHYVSAQS
DRLVVLVDQRYPPDAVDSLATQRPVHLITCLAEPDPSWWDRLAPVSHHPANSDGFGALARRIAGRSLGLVMAGGGARGLA
HFGVYQELTEAGVVIDRFGGTSSGAIASAAFALGMDAGDAIAAAREFIAGSDPLGDYTIPISALTRGGRVDRLVQGFFGN
TLIEHLPRGFFSVSADMITGDQIIHRRGSVSGAVRASISIPGLIPPVHNGEQLLVDGGLLNNLPANVMCADTDGEVICVD
LRRTFVPSKGFGLLPPIVTPPGLLRRLLTGTDNALPPLQETLLRAFDLAASTANLRELPRVAAIIEPDVSKIGVLNFKQI
DAALEAGRMAARAALQAQPDLVR

Sequences:

>Translated_583_residues
MTTARRRPKRRGTDARTALRNVPILADIDDEQLERLATTVERRHVPANQWLFHAGEPADSIYIVDSGRFVAVAPEGHVFA
EMASGDSIGDLGVIAGAARSAGVRALRDGVVWRIAAETFTDMLEATPLLQSAMLRAMARMLRQSRPAKTARRPRVIGVVS
NGDTAAAPMVDAIATSLDSHGRTAVIAPPVETTSAVQEYDELVEAFSETLDRAERSNDWVLVVADRGAGDLWRHYVSAQS
DRLVVLVDQRYPPDAVDSLATQRPVHLITCLAEPDPSWWDRLAPVSHHPANSDGFGALARRIAGRSLGLVMAGGGARGLA
HFGVYQELTEAGVVIDRFGGTSSGAIASAAFALGMDAGDAIAAAREFIAGSDPLGDYTIPISALTRGGRVDRLVQGFFGN
TLIEHLPRGFFSVSADMITGDQIIHRRGSVSGAVRASISIPGLIPPVHNGEQLLVDGGLLNNLPANVMCADTDGEVICVD
LRRTFVPSKGFGLLPPIVTPPGLLRRLLTGTDNALPPLQETLLRAFDLAASTANLRELPRVAAIIEPDVSKIGVLNFKQI
DAALEAGRMAARAALQAQPDLVR
>Mature_582_residues
TTARRRPKRRGTDARTALRNVPILADIDDEQLERLATTVERRHVPANQWLFHAGEPADSIYIVDSGRFVAVAPEGHVFAE
MASGDSIGDLGVIAGAARSAGVRALRDGVVWRIAAETFTDMLEATPLLQSAMLRAMARMLRQSRPAKTARRPRVIGVVSN
GDTAAAPMVDAIATSLDSHGRTAVIAPPVETTSAVQEYDELVEAFSETLDRAERSNDWVLVVADRGAGDLWRHYVSAQSD
RLVVLVDQRYPPDAVDSLATQRPVHLITCLAEPDPSWWDRLAPVSHHPANSDGFGALARRIAGRSLGLVMAGGGARGLAH
FGVYQELTEAGVVIDRFGGTSSGAIASAAFALGMDAGDAIAAAREFIAGSDPLGDYTIPISALTRGGRVDRLVQGFFGNT
LIEHLPRGFFSVSADMITGDQIIHRRGSVSGAVRASISIPGLIPPVHNGEQLLVDGGLLNNLPANVMCADTDGEVICVDL
RRTFVPSKGFGLLPPIVTPPGLLRRLLTGTDNALPPLQETLLRAFDLAASTANLRELPRVAAIIEPDVSKIGVLNFKQID
AALEAGRMAARAALQAQPDLVR

Specific function: Unknown

COG id: COG1752

COG function: function code R; Predicted esterase of the alpha-beta hydrolase superfamily

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 patatin domain

Homologues:

Organism=Homo sapiens, GI260656041, Length=193, Percent_Identity=35.7512953367876, Blast_Score=120, Evalue=2e-27,
Organism=Homo sapiens, GI116256487, Length=193, Percent_Identity=35.7512953367876, Blast_Score=120, Evalue=2e-27,
Organism=Homo sapiens, GI260656039, Length=193, Percent_Identity=35.7512953367876, Blast_Score=120, Evalue=2e-27,
Organism=Homo sapiens, GI260656037, Length=193, Percent_Identity=35.7512953367876, Blast_Score=120, Evalue=3e-27,
Organism=Homo sapiens, GI260656043, Length=193, Percent_Identity=35.7512953367876, Blast_Score=120, Evalue=3e-27,
Organism=Homo sapiens, GI148727290, Length=199, Percent_Identity=33.6683417085427, Blast_Score=110, Evalue=3e-24,
Organism=Homo sapiens, GI148727335, Length=199, Percent_Identity=33.6683417085427, Blast_Score=110, Evalue=3e-24,
Organism=Escherichia coli, GI226510936, Length=183, Percent_Identity=34.4262295081967, Blast_Score=89, Evalue=7e-19,
Organism=Caenorhabditis elegans, GI193204778, Length=299, Percent_Identity=28.4280936454849, Blast_Score=92, Evalue=7e-19,
Organism=Caenorhabditis elegans, GI71997289, Length=306, Percent_Identity=29.7385620915033, Blast_Score=82, Evalue=7e-16,
Organism=Caenorhabditis elegans, GI71997299, Length=306, Percent_Identity=29.7385620915033, Blast_Score=82, Evalue=7e-16,
Organism=Saccharomyces cerevisiae, GI6323581, Length=204, Percent_Identity=34.3137254901961, Blast_Score=116, Evalue=1e-26,
Organism=Drosophila melanogaster, GI28571388, Length=504, Percent_Identity=25.3968253968254, Blast_Score=114, Evalue=2e-25,
Organism=Drosophila melanogaster, GI281376913, Length=504, Percent_Identity=25.1984126984127, Blast_Score=107, Evalue=2e-23,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): Y2565_MYCTU (P0A642)

Other databases:

- EMBL:   BX842580
- EMBL:   AE000516
- PIR:   A70729
- RefSeq:   NP_217081.1
- RefSeq:   NP_337140.1
- ProteinModelPortal:   P0A642
- SMR:   P0A642
- EnsemblBacteria:   EBMYCT00000003448
- EnsemblBacteria:   EBMYCT00000071878
- GeneID:   887288
- GeneID:   925673
- GenomeReviews:   AE000516_GR
- GenomeReviews:   AL123456_GR
- KEGG:   mtc:MT2641
- KEGG:   mtu:Rv2565
- TIGR:   MT2641
- TubercuList:   Rv2565
- GeneTree:   EBGT00050000014781
- HOGENOM:   HBG131045
- OMA:   WPEGADE
- ProtClustDB:   CLSK791926
- GO:   GO:0005829
- InterPro:   IPR016035
- InterPro:   IPR018490
- InterPro:   IPR000595
- InterPro:   IPR001423
- InterPro:   IPR002641
- InterPro:   IPR014710
- Gene3D:   G3DSA:2.60.120.10
- SMART:   SM00100

Pfam domain/function: PF00027 cNMP_binding; PF01734 Patatin; SSF52151 Acyl_Trfase/lysoPlipase; SSF51206 cNMP_binding

EC number: NA

Molecular weight: Translated: 62125; Mature: 61993

Theoretical pI: Translated: 6.25; Mature: 6.25

Prosite motif: PS00888 CNMP_BINDING_1; PS00889 CNMP_BINDING_2; PS50042 CNMP_BINDING_3; PS01237 UPF0028

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.5 %Cys     (Translated Protein)
2.1 %Met     (Translated Protein)
2.6 %Cys+Met (Translated Protein)
0.5 %Cys     (Mature Protein)
1.9 %Met     (Mature Protein)
2.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MTTARRRPKRRGTDARTALRNVPILADIDDEQLERLATTVERRHVPANQWLFHAGEPADS
CCCCCCCCCCCCCHHHHHHHCCCEEEECCHHHHHHHHHHHHHHCCCHHHCEEECCCCCCE
IYIVDSGRFVAVAPEGHVFAEMASGDSIGDLGVIAGAARSAGVRALRDGVVWRIAAETFT
EEEEECCCEEEECCCCCEEEEECCCCCCCCHHHHHHHHHHHHHHHHHCCCEEEEHHHHHH
DMLEATPLLQSAMLRAMARMLRQSRPAKTARRPRVIGVVSNGDTAAAPMVDAIATSLDSH
HHHHHHHHHHHHHHHHHHHHHHHCCCCHHHCCCEEEEEEECCCCCHHHHHHHHHHHHCCC
GRTAVIAPPVETTSAVQEYDELVEAFSETLDRAERSNDWVLVVADRGAGDLWRHYVSAQS
CCEEEEECCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEEEECCCCHHHHHHHHCCCC
DRLVVLVDQRYPPDAVDSLATQRPVHLITCLAEPDPSWWDRLAPVSHHPANSDGFGALAR
CCEEEEECCCCCCHHHHHHHHCCCEEEEEEECCCCCCHHHHCCCCCCCCCCCCCHHHHHH
RIAGRSLGLVMAGGGARGLAHFGVYQELTEAGVVIDRFGGTSSGAIASAAFALGMDAGDA
HHCCCCCEEEEECCCCCHHHHHHHHHHHHHCCEEEECCCCCCCCHHHHHHHHHCCCCCHH
IAAAREFIAGSDPLGDYTIPISALTRGGRVDRLVQGFFGNTLIEHLPRGFFSVSADMITG
HHHHHHHHCCCCCCCCEEEEHHHHCCCCHHHHHHHHHHHHHHHHHCCCCHHEECHHHCCC
DQIIHRRGSVSGAVRASISIPGLIPPVHNGEQLLVDGGLLNNLPANVMCADTDGEVICVD
HHHHHHCCCCCCEEEEEEECCCCCCCCCCCCEEEEECCHHCCCCCCEEEECCCCCEEEEE
LRRTFVPSKGFGLLPPIVTPPGLLRRLLTGTDNALPPLQETLLRAFDLAASTANLRELPR
EHHHCCCCCCCCCCCCCCCCHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHCHHHHHHHHH
VAAIIEPDVSKIGVLNFKQIDAALEAGRMAARAALQAQPDLVR
HHHHCCCCHHHHCCCCHHHHHHHHHHHHHHHHHHHHCCCCCCC
>Mature Secondary Structure 
TTARRRPKRRGTDARTALRNVPILADIDDEQLERLATTVERRHVPANQWLFHAGEPADS
CCCCCCCCCCCCHHHHHHHCCCEEEECCHHHHHHHHHHHHHHCCCHHHCEEECCCCCCE
IYIVDSGRFVAVAPEGHVFAEMASGDSIGDLGVIAGAARSAGVRALRDGVVWRIAAETFT
EEEEECCCEEEECCCCCEEEEECCCCCCCCHHHHHHHHHHHHHHHHHCCCEEEEHHHHHH
DMLEATPLLQSAMLRAMARMLRQSRPAKTARRPRVIGVVSNGDTAAAPMVDAIATSLDSH
HHHHHHHHHHHHHHHHHHHHHHHCCCCHHHCCCEEEEEEECCCCCHHHHHHHHHHHHCCC
GRTAVIAPPVETTSAVQEYDELVEAFSETLDRAERSNDWVLVVADRGAGDLWRHYVSAQS
CCEEEEECCCCHHHHHHHHHHHHHHHHHHHHHHHCCCCEEEEEECCCCHHHHHHHHCCCC
DRLVVLVDQRYPPDAVDSLATQRPVHLITCLAEPDPSWWDRLAPVSHHPANSDGFGALAR
CCEEEEECCCCCCHHHHHHHHCCCEEEEEEECCCCCCHHHHCCCCCCCCCCCCCHHHHHH
RIAGRSLGLVMAGGGARGLAHFGVYQELTEAGVVIDRFGGTSSGAIASAAFALGMDAGDA
HHCCCCCEEEEECCCCCHHHHHHHHHHHHHCCEEEECCCCCCCCHHHHHHHHHCCCCCHH
IAAAREFIAGSDPLGDYTIPISALTRGGRVDRLVQGFFGNTLIEHLPRGFFSVSADMITG
HHHHHHHHCCCCCCCCEEEEHHHHCCCCHHHHHHHHHHHHHHHHHCCCCHHEECHHHCCC
DQIIHRRGSVSGAVRASISIPGLIPPVHNGEQLLVDGGLLNNLPANVMCADTDGEVICVD
HHHHHHCCCCCCEEEEEEECCCCCCCCCCCCEEEEECCHHCCCCCCEEEECCCCCEEEEE
LRRTFVPSKGFGLLPPIVTPPGLLRRLLTGTDNALPPLQETLLRAFDLAASTANLRELPR
EHHHCCCCCCCCCCCCCCCCHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHCHHHHHHHHH
VAAIIEPDVSKIGVLNFKQIDAALEAGRMAARAALQAQPDLVR
HHHHCCCCHHHHCCCCHHHHHHHHHHHHHHHHHHHHCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 9634230; 12218036