| Definition | Mycobacterium tuberculosis F11, complete genome. |
|---|---|
| Accession | NC_009565 |
| Length | 4,424,435 |
Click here to switch to the map view.
The map label for this gene is 148824104
Identifier: 148824104
GI number: 148824104
Start: 3235097
End: 3236209
Strand: Reverse
Name: 148824104
Synonym: TBFG_12929
Alternate gene names: NA
Gene position: 3236209-3235097 (Counterclockwise)
Preceding gene: 148824105
Following gene: 148824103
Centisome position: 73.14
GC content: 68.19
Gene sequence:
>1113_bases GTGAAGCGGGTCGACACCATCAGGCCCCGTAGCCGCGCCGTGCGCCTGCACGTGCGAGGTTTGGGCCTGCCCGACGAGAC GGCGATCCAACTGTGGATCGTCGACGGCCGCATTAGCACCGAACCGGTGGCAGGAGCCGACACCGTCTTTGACGGCGGCT GGATCCTGCCCGGGCTGGTCGACGCGCACTGCCATGTCGGGCTTGGGAAACACGGCAACGTCGAACTCGACGAGGCGATC GCTCAGGCCGAGACCGAACGTGACGTCGGCGCGCTGCTGTTGCGGGACTGCGGCTCGCCGACCGACACCCGCGGCCTTGA CGACCACGAAGACCTGCCCCGCATCATCCGCGCCGGACGGCACCTGGCCAGACCCAAGCGTTACATCGCCGGCTTCGCGG TCGAGCTCGAAGACGAATCCCAGCTGCCGGCAGCGGTAGCCGAGCAGGCCCGCCGCGGTGACGGCTGGGTCAAGCTGGTC GGTGACTGGATCGACCGTCAAATCGGCGATCTTGCCCCGTTGTGGTCCGATGACGTGCTCAAAGCCGCCATCGACACGGC ACACGCTCAGGGCGCCCGGGTCACCGCGCACGTTTTCAGCGAGGACGCGCTGCCCGGCTTGATCAACGCCGGCATCGACT GCATCGAGCACGGCACCGGCCTCACCGACGACACCATCGCCTTGATGCTCGAGCACGGCACCGCGTTGGTCCCCACGCTG ATCAACCTGGAAAACTTTCCGGGCATTGCCGATGCGGCAGGGCGCTATCCAACCTATGCCGCGCACATGCGCGACCTGTA TGCCCGCGGCTATGGGCGGGTCGCTGCGGCGCGGGAGGCGGGGGTGCCGGTATACGCGGGCACCGATGCGGGCAGCACGA TCGAGCACGGACGGATCGCTGACGAGGTAGCGGCGCTGCAGAGGATTGGGATGACCGCGCACGAGGCGTTGGGCGCGGCG TGCTGGGATGCTCGACGCTGGCTGGGCCGGCCCGGGCTGGACGATAGGGCATCGGCCGACCTGTTGTGCTACGCCCAGGA TCCGCGGCAGGGTCCGGGTGTGCTGCAGCATCCCGATCTGGTGATTTTGCGCGGCAGGACTTTTGGGCCCTAG
Upstream 100 bases:
>100_bases AGGTCTCGACGAGCTGCCGCCCGGCCTGGCCGACTTCGACCTGTCCAAGCTGAAGTTCCCAGGCAAGAAGTAGTGGCGAT CGCGAGTGCGGCGGAGCCGG
Downstream 100 bases:
>100_bases CTTTGGCCGCGCGGGCCGTGCCGAACGCGGTTACTATCGGCCAATGGCGTTGGCCAGCGGCGTGACCTTTGCCGGCTACA CCGTCGTGCGGATGCTGGGT
Product: hypothetical protein
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 370; Mature: 370
Protein sequence:
>370_residues MKRVDTIRPRSRAVRLHVRGLGLPDETAIQLWIVDGRISTEPVAGADTVFDGGWILPGLVDAHCHVGLGKHGNVELDEAI AQAETERDVGALLLRDCGSPTDTRGLDDHEDLPRIIRAGRHLARPKRYIAGFAVELEDESQLPAAVAEQARRGDGWVKLV GDWIDRQIGDLAPLWSDDVLKAAIDTAHAQGARVTAHVFSEDALPGLINAGIDCIEHGTGLTDDTIALMLEHGTALVPTL INLENFPGIADAAGRYPTYAAHMRDLYARGYGRVAAAREAGVPVYAGTDAGSTIEHGRIADEVAALQRIGMTAHEALGAA CWDARRWLGRPGLDDRASADLLCYAQDPRQGPGVLQHPDLVILRGRTFGP
Sequences:
>Translated_370_residues MKRVDTIRPRSRAVRLHVRGLGLPDETAIQLWIVDGRISTEPVAGADTVFDGGWILPGLVDAHCHVGLGKHGNVELDEAI AQAETERDVGALLLRDCGSPTDTRGLDDHEDLPRIIRAGRHLARPKRYIAGFAVELEDESQLPAAVAEQARRGDGWVKLV GDWIDRQIGDLAPLWSDDVLKAAIDTAHAQGARVTAHVFSEDALPGLINAGIDCIEHGTGLTDDTIALMLEHGTALVPTL INLENFPGIADAAGRYPTYAAHMRDLYARGYGRVAAAREAGVPVYAGTDAGSTIEHGRIADEVAALQRIGMTAHEALGAA CWDARRWLGRPGLDDRASADLLCYAQDPRQGPGVLQHPDLVILRGRTFGP >Mature_370_residues MKRVDTIRPRSRAVRLHVRGLGLPDETAIQLWIVDGRISTEPVAGADTVFDGGWILPGLVDAHCHVGLGKHGNVELDEAI AQAETERDVGALLLRDCGSPTDTRGLDDHEDLPRIIRAGRHLARPKRYIAGFAVELEDESQLPAAVAEQARRGDGWVKLV GDWIDRQIGDLAPLWSDDVLKAAIDTAHAQGARVTAHVFSEDALPGLINAGIDCIEHGTGLTDDTIALMLEHGTALVPTL INLENFPGIADAAGRYPTYAAHMRDLYARGYGRVAAAREAGVPVYAGTDAGSTIEHGRIADEVAALQRIGMTAHEALGAA CWDARRWLGRPGLDDRASADLLCYAQDPRQGPGVLQHPDLVILRGRTFGP
Specific function: Unknown
COG id: COG1228
COG function: function code Q; Imidazolonepropionase and related amidohydrolases
Gene ontology:
Cell location: Cytoplasmic
Metaboloic importance: NA
Operon status: Not Known
Operon components: None
Similarity: To S.coelicolor SCO1861
Homologues:
Organism=Saccharomyces cerevisiae, GI6322248, Length=234, Percent_Identity=27.3504273504274, Blast_Score=67, Evalue=5e-12,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): Y2915_MYCTU (P68917)
Other databases:
- EMBL: BX842581 - EMBL: AE000516 - PIR: C70747 - RefSeq: NP_217431.1 - ProteinModelPortal: P68917 - EnsemblBacteria: EBMYCT00000000318 - EnsemblBacteria: EBMYCT00000084045 - GeneID: 888083 - GenomeReviews: AE000516_GR - GenomeReviews: AL123456_GR - KEGG: mtu:Rv2915c - TIGR: MT2982.1 - TubercuList: Rv2915c - GeneTree: EBGT00050000016210 - HOGENOM: HBG292371 - OMA: TAHCFAE - ProtClustDB: CLSK872120 - InterPro: IPR006680
Pfam domain/function: PF01979 Amidohydro_1
EC number: NA
Molecular weight: Translated: 39770; Mature: 39770
Theoretical pI: Translated: 5.25; Mature: 5.25
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
1.4 %Cys (Translated Protein) 1.1 %Met (Translated Protein) 2.4 %Cys+Met (Translated Protein) 1.4 %Cys (Mature Protein) 1.1 %Met (Mature Protein) 2.4 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MKRVDTIRPRSRAVRLHVRGLGLPDETAIQLWIVDGRISTEPVAGADTVFDGGWILPGLV CCCCCCCCCCCCEEEEEEEECCCCCCCEEEEEEECCCCCCCCCCCCCCEECCCEECCCHH DAHCHVGLGKHGNVELDEAIAQAETERDVGALLLRDCGSPTDTRGLDDHEDLPRIIRAGR CCCEEECCCCCCCEEHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCHHHHHHHHHHHH HLARPKRYIAGFAVELEDESQLPAAVAEQARRGDGWVKLVGDWIDRQIGDLAPLWSDDVL HHHCCHHHHEEEEEEECCCCCCCHHHHHHHHCCCCEEEEHHHHHHHHHHHCCCCCCHHHH KAAIDTAHAQGARVTAHVFSEDALPGLINAGIDCIEHGTGLTDDTIALMLEHGTALVPTL HHHHHHHHCCCCEEEEEECCCCCCCHHHHHCHHHHHCCCCCCCHHHHHHHHCCCCHHHHH INLENFPGIADAAGRYPTYAAHMRDLYARGYGRVAAAREAGVPVYAGTDAGSTIEHGRIA HCCCCCCCCHHHCCCCCHHHHHHHHHHHCCCCCHHHHHHCCCCEEECCCCCCCCCCCHHH DEVAALQRIGMTAHEALGAACWDARRWLGRPGLDDRASADLLCYAQDPRQGPGVLQHPDL HHHHHHHHHCCHHHHHHHHHHHHHHHHCCCCCCCCCCCCCEEEEECCCCCCCCCCCCCCE VILRGRTFGP EEECCCCCCC >Mature Secondary Structure MKRVDTIRPRSRAVRLHVRGLGLPDETAIQLWIVDGRISTEPVAGADTVFDGGWILPGLV CCCCCCCCCCCCEEEEEEEECCCCCCCEEEEEEECCCCCCCCCCCCCCEECCCEECCCHH DAHCHVGLGKHGNVELDEAIAQAETERDVGALLLRDCGSPTDTRGLDDHEDLPRIIRAGR CCCEEECCCCCCCEEHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCHHHHHHHHHHHH HLARPKRYIAGFAVELEDESQLPAAVAEQARRGDGWVKLVGDWIDRQIGDLAPLWSDDVL HHHCCHHHHEEEEEEECCCCCCCHHHHHHHHCCCCEEEEHHHHHHHHHHHCCCCCCHHHH KAAIDTAHAQGARVTAHVFSEDALPGLINAGIDCIEHGTGLTDDTIALMLEHGTALVPTL HHHHHHHHCCCCEEEEEECCCCCCCHHHHHCHHHHHCCCCCCCHHHHHHHHCCCCHHHHH INLENFPGIADAAGRYPTYAAHMRDLYARGYGRVAAAREAGVPVYAGTDAGSTIEHGRIA HCCCCCCCCHHHCCCCCHHHHHHHHHHHCCCCCHHHHHHCCCCEEECCCCCCCCCCCHHH DEVAALQRIGMTAHEALGAACWDARRWLGRPGLDDRASADLLCYAQDPRQGPGVLQHPDL HHHHHHHHHCCHHHHHHHHHHHHHHHHCCCCCCCCCCCCCEEEEECCCCCCCCCCCCCCE VILRGRTFGP EEECCCCCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 10.0
TargetDB status: NA
Availability: NA
References: 9634230; 12218036