| Definition | Mycobacterium tuberculosis F11, complete genome. |
|---|---|
| Accession | NC_009565 |
| Length | 4,424,435 |
Click here to switch to the map view.
The map label for this gene is 148824102
Identifier: 148824102
GI number: 148824102
Start: 3231392
End: 3233227
Strand: Reverse
Name: 148824102
Synonym: TBFG_12927
Alternate gene names: NA
Gene position: 3233227-3231392 (Counterclockwise)
Preceding gene: 148824103
Following gene: 148824101
Centisome position: 73.08
GC content: 64.81
Gene sequence:
>1836_bases ATGTTAGCTTGGCGGCAACTCAACGATCTGGAGGAAACGGTGACCTACGACGTGATCATTCGCGACGGACTGTGGTTCGA CGGCACCGGCAATGCGCCATTGACTCGCACTCTGGGCATTCGCGACGGCGTGGTGGCCACGGTGGCTGCCGGCGCACTGG ACGAGACCGGCTGCCCGGAGGTGGTTGATGCGGCGGGGAAGTGGGTCGTGCCTGGCTTCATCGACGTGCACACCCACTAT GACGCCGAGGTGTTGCTCGATCCTGGTTTGCGGGAGTCGGTGCGCCACGGTGTCACCACGGTGCTGCTGGGAAACTGCTC GTTGTCGACGGTCTACGCCAACTCCGAGGATGCCGCCGACCTGTTCAGCCGTGTTGAAGCGGTGCCCCGCGAATTTGTCC TGGGTGCCCTGCGGGACAACCAGACGTGGTCGACGCCCGCGGAGTACATCGAAGCGATCGACGCCCTGCCCCTCGGGCCG AATGTGAGTTCACTGCTTGGCCATTCGGATCTGCGGACCGCGGTACTGGGCCTTGATCGTGCCACCGACGACACCGTCCG GCCCACCGAAGCCGAGCTGGCGAAGATGGCGAAACTGCTCGATGAGGCGCTCGAGGCCGGGATGCTGGGCATGTCCGGGA TGGACGCCGCTATCGACAAGCTCGACGGCGACCGCTTCCGCTCGCGTGCGCTGCCGTCCACCTTCGCGACCTGGCGGGAG CGTCGCAAGCTGATCTCGGTGCTGCGCCACCGGGGCCGGATACTGCAGAGCGCACCCGACGTCGACAACCCGGTGTCCGC GCTGCTGTTTTTCTTGGCCAGCAGCCGGATATTCAACCGGCGCAAGGGCGTTCGAATGAGCATGTTGGTGTCCGCCGACG CCAAGTCGATGCCGCTGGCGGTACACGTGTTCGGGTTGGGCACCCGCGTGCTGAACAAGCTCTTAGGCTCTCAGGTGCGA TTCCAGCATCTGCCGGTCCCGTTCGAGCTGTACTCCGACGGCATCGACCTGCCGGTCTTCGAGGAGTTCGGCGCCGGAAC GGCGGCCCTTCATCTGCGTGACCAACTGCAGCGCAACGAGCTCCTGGCCGACAGGTCTTACCGCCGGTCGTTCCGGCGCG AGTTCGATCGCATCAAGCTCGGACCTTCGTTGTGGCATCGGGACTTCCACGACGCCGTGATCGTCGAATGCCCGGATAAG TCGTTGATCGGTAAGAGTTTCGGGGCAATAGCCGACGAGCGCGGGCTGCACCCGCTGGACGCGTTCCTCGATGTGCTGGT GGACAACGGGGAGCGCAATGTCCGATGGACCACCATCGTCGCCAATCACCGGCCCAACCAGCTGAACAAGCTGGCCGCCG AACCGAGTGTCCACATGGGCTTCTCCGACGCCGGCGCGCACCTGCGCAATATGGCGTTCTACAACTTCGGGCTTCGGCTG CTCAAACGAGCCAGAGACGCCGACCGGGCCGGACAACCGTTTCTGTCCATCGAGCGGGCAGTGTATCGCCTCACCGGTGA GTTGGCCGAGTGGTTCGGTATAGGCGCGGGCACGTTGCGCCAGGGTGACCGTGCGGACTTCGCGGTGATTGACCCTACCC ACCTAGATGAATCGGTGGACGGGTACCACGAGGAGGCGGTGCCCTACTATGGCGGTCTGCGACGCATGGTCAACCGCAAC GATGCGACCGTGGTTGCGACGGGCGTGGGCGGCACCGTGGTATTCCGCGGAGGCCAGTTCGGAGGTCAGTTCCGCGACGG CTACGGGCAGAACGTGAAGTCGGGTCGCTACCTGCGGGCGGGTGAGCTCGGCGCCGCTCTGAGCCGTTCTGCCTGA
Upstream 100 bases:
>100_bases CGACCACAACGGCGCCGGGGCCCGGTCGCTGACACCCACTTGACCAGCGCCGCGGCAGCGAAGCGGCGTCAGCCAAAAAG ATTGCGAGTGATCGCTATCT
Downstream 100 bases:
>100_bases CATGGCCAGGACCCAGCAGCAGCGCCGCGAAGAAACCGTTGCACGGCTTCTGCAGGCCAGCATCGACACGATCATCGAGG TCGGCTACGCGCGGGCATCG
Product: D-amino acid aminohydrolase
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 611; Mature: 611
Protein sequence:
>611_residues MLAWRQLNDLEETVTYDVIIRDGLWFDGTGNAPLTRTLGIRDGVVATVAAGALDETGCPEVVDAAGKWVVPGFIDVHTHY DAEVLLDPGLRESVRHGVTTVLLGNCSLSTVYANSEDAADLFSRVEAVPREFVLGALRDNQTWSTPAEYIEAIDALPLGP NVSSLLGHSDLRTAVLGLDRATDDTVRPTEAELAKMAKLLDEALEAGMLGMSGMDAAIDKLDGDRFRSRALPSTFATWRE RRKLISVLRHRGRILQSAPDVDNPVSALLFFLASSRIFNRRKGVRMSMLVSADAKSMPLAVHVFGLGTRVLNKLLGSQVR FQHLPVPFELYSDGIDLPVFEEFGAGTAALHLRDQLQRNELLADRSYRRSFRREFDRIKLGPSLWHRDFHDAVIVECPDK SLIGKSFGAIADERGLHPLDAFLDVLVDNGERNVRWTTIVANHRPNQLNKLAAEPSVHMGFSDAGAHLRNMAFYNFGLRL LKRARDADRAGQPFLSIERAVYRLTGELAEWFGIGAGTLRQGDRADFAVIDPTHLDESVDGYHEEAVPYYGGLRRMVNRN DATVVATGVGGTVVFRGGQFGGQFRDGYGQNVKSGRYLRAGELGAALSRSA
Sequences:
>Translated_611_residues MLAWRQLNDLEETVTYDVIIRDGLWFDGTGNAPLTRTLGIRDGVVATVAAGALDETGCPEVVDAAGKWVVPGFIDVHTHY DAEVLLDPGLRESVRHGVTTVLLGNCSLSTVYANSEDAADLFSRVEAVPREFVLGALRDNQTWSTPAEYIEAIDALPLGP NVSSLLGHSDLRTAVLGLDRATDDTVRPTEAELAKMAKLLDEALEAGMLGMSGMDAAIDKLDGDRFRSRALPSTFATWRE RRKLISVLRHRGRILQSAPDVDNPVSALLFFLASSRIFNRRKGVRMSMLVSADAKSMPLAVHVFGLGTRVLNKLLGSQVR FQHLPVPFELYSDGIDLPVFEEFGAGTAALHLRDQLQRNELLADRSYRRSFRREFDRIKLGPSLWHRDFHDAVIVECPDK SLIGKSFGAIADERGLHPLDAFLDVLVDNGERNVRWTTIVANHRPNQLNKLAAEPSVHMGFSDAGAHLRNMAFYNFGLRL LKRARDADRAGQPFLSIERAVYRLTGELAEWFGIGAGTLRQGDRADFAVIDPTHLDESVDGYHEEAVPYYGGLRRMVNRN DATVVATGVGGTVVFRGGQFGGQFRDGYGQNVKSGRYLRAGELGAALSRSA >Mature_611_residues MLAWRQLNDLEETVTYDVIIRDGLWFDGTGNAPLTRTLGIRDGVVATVAAGALDETGCPEVVDAAGKWVVPGFIDVHTHY DAEVLLDPGLRESVRHGVTTVLLGNCSLSTVYANSEDAADLFSRVEAVPREFVLGALRDNQTWSTPAEYIEAIDALPLGP NVSSLLGHSDLRTAVLGLDRATDDTVRPTEAELAKMAKLLDEALEAGMLGMSGMDAAIDKLDGDRFRSRALPSTFATWRE RRKLISVLRHRGRILQSAPDVDNPVSALLFFLASSRIFNRRKGVRMSMLVSADAKSMPLAVHVFGLGTRVLNKLLGSQVR FQHLPVPFELYSDGIDLPVFEEFGAGTAALHLRDQLQRNELLADRSYRRSFRREFDRIKLGPSLWHRDFHDAVIVECPDK SLIGKSFGAIADERGLHPLDAFLDVLVDNGERNVRWTTIVANHRPNQLNKLAAEPSVHMGFSDAGAHLRNMAFYNFGLRL LKRARDADRAGQPFLSIERAVYRLTGELAEWFGIGAGTLRQGDRADFAVIDPTHLDESVDGYHEEAVPYYGGLRRMVNRN DATVVATGVGGTVVFRGGQFGGQFRDGYGQNVKSGRYLRAGELGAALSRSA
Specific function: Unknown
COG id: COG3653
COG function: function code Q; N-acyl-D-aspartate/D-glutamate deacylase
Gene ontology:
Cell location: Cytoplasmic
Metaboloic importance: NA
Operon status: Not Known
Operon components: None
Similarity: Belongs to the N-acyl-D-amino-acid deacylase family
Homologues:
None
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): Y2913_MYCTU (P65530)
Other databases:
- EMBL: BX842581 - EMBL: AE000516 - PIR: D70928 - RefSeq: NP_217429.1 - RefSeq: NP_337493.1 - ProteinModelPortal: P65530 - SMR: P65530 - EnsemblBacteria: EBMYCT00000003852 - EnsemblBacteria: EBMYCT00000070791 - GeneID: 887809 - GeneID: 925294 - GenomeReviews: AE000516_GR - GenomeReviews: AL123456_GR - KEGG: mtc:MT2981 - KEGG: mtu:Rv2913c - TIGR: MT2981 - TubercuList: Rv2913c - GeneTree: EBGT00050000016209 - HOGENOM: HBG529050 - OMA: VANHRPK - ProtClustDB: CLSK792156 - GO: GO:0005829 - InterPro: IPR013108 - InterPro: IPR011059
Pfam domain/function: PF07969 Amidohydro_3; SSF51338 Metalo_hydrolase
EC number: NA
Molecular weight: Translated: 67206; Mature: 67206
Theoretical pI: Translated: 6.42; Mature: 6.42
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.5 %Cys (Translated Protein) 1.8 %Met (Translated Protein) 2.3 %Cys+Met (Translated Protein) 0.5 %Cys (Mature Protein) 1.8 %Met (Mature Protein) 2.3 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MLAWRQLNDLEETVTYDVIIRDGLWFDGTGNAPLTRTLGIRDGVVATVAAGALDETGCPE CCCCHHHHHHHHHHEEEEEEECCEEECCCCCCCCEEECCCCCCHHHHHHHCCCCCCCCCH VVDAAGKWVVPGFIDVHTHYDAEVLLDPGLRESVRHGVTTVLLGNCSLSTVYANSEDAAD HHHCCCCEECCCEEEEECCCCCEEEECCCHHHHHHCCCEEEEEECCCEEEEECCCCHHHH LFSRVEAVPREFVLGALRDNQTWSTPAEYIEAIDALPLGPNVSSLLGHSDLRTAVLGLDR HHHHHHHCCHHHHHHHHCCCCCCCCHHHHHHHHHCCCCCCCHHHHHCCHHHHHHHHHCCC ATDDTVRPTEAELAKMAKLLDEALEAGMLGMSGMDAAIDKLDGDRFRSRALPSTFATWRE CCCCCCCCCHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHCCCHHHHHHCCCHHHHHHHH RRKLISVLRHRGRILQSAPDVDNPVSALLFFLASSRIFNRRKGVRMSMLVSADAKSMPLA HHHHHHHHHHHCHHHHCCCCCCCHHHHHHHHHHHHHHHHHHCCCEEEEEEECCCCCCCEE VHVFGLGTRVLNKLLGSQVRFQHLPVPFELYSDGIDLPVFEEFGAGTAALHLRDQLQRNE EEEEHHHHHHHHHHHCCCHHHHCCCCCHHHHCCCCCCCCHHHHCCCCEEHHHHHHHHHHH LLADRSYRRSFRREFDRIKLGPSLWHRDFHDAVIVECPDKSLIGKSFGAIADERGLHPLD HHHHHHHHHHHHHHHHHCCCCHHHHHCCCCCEEEEECCCCHHHHHHHHCHHHCCCCCHHH AFLDVLVDNGERNVRWTTIVANHRPNQLNKLAAEPSVHMGFSDAGAHLRNMAFYNFGLRL HHHHHHHCCCCCCEEEEEEEECCCCCHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHH LKRARDADRAGQPFLSIERAVYRLTGELAEWFGIGAGTLRQGDRADFAVIDPTHLDESVD HHHHHCHHHCCCCHHHHHHHHHHHHHHHHHHHCCCCHHCCCCCCCCEEEECCHHCCCHHC GYHEEAVPYYGGLRRMVNRNDATVVATGVGGTVVFRGGQFGGQFRDGYGQNVKSGRYLRA CHHHHCCCHHHHHHHHHCCCCCEEEEECCCCEEEEECCCCCCCCCCCCCCCCCCCCEEEC GELGAALSRSA CCHHHHHHCCC >Mature Secondary Structure MLAWRQLNDLEETVTYDVIIRDGLWFDGTGNAPLTRTLGIRDGVVATVAAGALDETGCPE CCCCHHHHHHHHHHEEEEEEECCEEECCCCCCCCEEECCCCCCHHHHHHHCCCCCCCCCH VVDAAGKWVVPGFIDVHTHYDAEVLLDPGLRESVRHGVTTVLLGNCSLSTVYANSEDAAD HHHCCCCEECCCEEEEECCCCCEEEECCCHHHHHHCCCEEEEEECCCEEEEECCCCHHHH LFSRVEAVPREFVLGALRDNQTWSTPAEYIEAIDALPLGPNVSSLLGHSDLRTAVLGLDR HHHHHHHCCHHHHHHHHCCCCCCCCHHHHHHHHHCCCCCCCHHHHHCCHHHHHHHHHCCC ATDDTVRPTEAELAKMAKLLDEALEAGMLGMSGMDAAIDKLDGDRFRSRALPSTFATWRE CCCCCCCCCHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHHCCCHHHHHHCCCHHHHHHHH RRKLISVLRHRGRILQSAPDVDNPVSALLFFLASSRIFNRRKGVRMSMLVSADAKSMPLA HHHHHHHHHHHCHHHHCCCCCCCHHHHHHHHHHHHHHHHHHCCCEEEEEEECCCCCCCEE VHVFGLGTRVLNKLLGSQVRFQHLPVPFELYSDGIDLPVFEEFGAGTAALHLRDQLQRNE EEEEHHHHHHHHHHHCCCHHHHCCCCCHHHHCCCCCCCCHHHHCCCCEEHHHHHHHHHHH LLADRSYRRSFRREFDRIKLGPSLWHRDFHDAVIVECPDKSLIGKSFGAIADERGLHPLD HHHHHHHHHHHHHHHHHCCCCHHHHHCCCCCEEEEECCCCHHHHHHHHCHHHCCCCCHHH AFLDVLVDNGERNVRWTTIVANHRPNQLNKLAAEPSVHMGFSDAGAHLRNMAFYNFGLRL HHHHHHHCCCCCCEEEEEEEECCCCCHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHH LKRARDADRAGQPFLSIERAVYRLTGELAEWFGIGAGTLRQGDRADFAVIDPTHLDESVD HHHHHCHHHCCCCHHHHHHHHHHHHHHHHHHHCCCCHHCCCCCCCCEEEECCHHCCCHHC GYHEEAVPYYGGLRRMVNRNDATVVATGVGGTVVFRGGQFGGQFRDGYGQNVKSGRYLRA CHHHHCCCHHHHHHHHHCCCCCEEEEECCCCEEEEECCCCCCCCCCCCCCCCCCCCEEEC GELGAALSRSA CCHHHHHHCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 9634230; 12218036