| Definition | Mycobacterium leprae Br4923 chromosome, complete genome. |
|---|---|
| Accession | NC_011896 |
| Length | 3,268,071 |
Click here to switch to the map view.
The map label for this gene is 221230333
Identifier: 221230333
GI number: 221230333
Start: 1947563
End: 1949353
Strand: Direct
Name: 221230333
Synonym: MLBr_01624
Alternate gene names: NA
Gene position: 1947563-1949353 (Clockwise)
Preceding gene: 221230332
Following gene: 221230340
Centisome position: 59.59
GC content: 61.7
Gene sequence:
>1791_bases ATGACCCAATCGGATCACCGCCACACGCGGCCAAGCAGCTACGGGGGAACTGTGTTGACGCAACGGGTCAGCCAAGCCAC TGTCGAAGACAGCCGACCGTTGCGGGGTTGGCAACGTCGAGCAATGGTAAAGTATTTGGCCAGCCAACCACGCGACTTCC TGGCCGTTGCCACGCCTGGATCCGGGAAAACAACGTTCGCCCTACGGGTGATGACCGAACTGCTGAACAGTCACGCTGTC GAGCAGGTTACCGTCGTTGTTCCCACCGAGCACCTCAAGGTTCAGTGGACCCGGGCCGCGGCAACCCACGGTCTGGCCCT GGACCCGAAATTTTCCAACACCAACCCGCGGACCTCGCCGGAGTATCACGGCGTGACGATGACCTACGCTCAAGTCGCCG CACATCCGACACTGCACCGGGTGCGCACCGAAGGTCGCAGAACCTTGGTGATCTTTGATGAGATCCATCATGGCGGTAAC GCCAAGGCTTGGGGCGACGCTATCCGAGAAGCCTTCAGCGACGCGACGCGCCGACTTGCACTGACGGGCACGCCATTTCG CAGCGACGACAAGCCAATTCCGTTCGTCACCTACGCACTCGACGCGGACGGGCTGATGCATTCACAGGCCGACCACACCT ATAGCTACGCCGAAGGCCTTGCCGACGGCGTAGTCCGGCCGGTGGTGTTCCTTGTCTATTCTGGGCAGGCGCGTTGGCGA AATAGTGCGGGTGAAGAACACGCGGCTCGACTGGGCGAGCCGCTGTCTGCGGAACAGACCGCGCGGGCGTGGCGGACCGC GCTGGACCCCTCTGGGGAATGGATGCCGGCGGTCATCTCCGCGGCCGATCAACGACTGCGCCAGCTTCGTACGCATGTAC CCGACGCCGGTGGCATGATCATCGCATCCGATCAGACCGCAGCCCGCGCGTACGCCAACCTGCTGGCGCAAATGACCTCA GAAACGCCGACGTTGGTGTTGTCCGACGACCCGGGATCTTCGGCCCGCATCACCGAATTCGCCAAGAACACCAGTCAGTG GCTAATCGCAGTCCGGATGGTCTCTGAGGGCGTCGACATACCTCGGTTGTCGGTGGGGATCTATGCCACCAGTGCCTCAA CGCCGTTGTTCTTCGCACAGGCTATCGGCCGGTTCGTGCGGTCTCGTCATCCAGGAGAAACCGCAAGCATATTCGTCCCG TCGGTGCCTAATCTGCTGCAGCTGGCCAGTGAGTTGGAGACCCAGCGCAACCATGTGCTGGGCAAACCGCACCGCGAATC AACCGACAATCCCCTCGGGGGCAATCCCGCCACGATGACACAAACCGAGCAAGACGACACTGAGAAGTATTTCACCGCAA TAGGAGCCGACGCCGAACTGGATCAGATCATTTTTGATGGATCATCGTTCGGCACCGCTACTCCTGCCGGGAGCGAGGAA GAAGCCTACTACCTCGGTATCCCTGGGTTGCTGGATGCCGACCAGATGCGAGCGCTGCTGCACCGCCGCCAAAACGAGCA GCTCCAAAAGCGGACCGCTGCACAACAAGCATCATCAACACCGGATAGGACCTCCGGGGCGCCGGCGTCTGTGCATGGCC AACTCCGCGAGCTGCGCCGCGAACTCAACTCGCTAGTCTCAATAGCCCATCACCATACCGGCAAGCCGCACGGCTGGATC CACAACGAACTTCGACGACGCTGCGGAGGACCGCCGATCGCCGCTGCTACCCACGATCAACTCAAAGCACGCATCGATGC CGTGCGGCAGCTCAACGCCGAGCCGTCGTAA
Upstream 100 bases:
>100_bases CACCTGACCGCACTGGCGTGTACCACTGTATCCATCGTACTTTCTGCTGTAACAGAACTAATGTGGCATAATGCGATAGC ACGCACTGAAAACATGAGAA
Downstream 100 bases:
>100_bases ACACGGATTTAGCTCACCGCTCATCGGCCGGAGCGCTCTGCGCAAGTGCCGTTCAACCCACCGTTCGCAGTGCTGCATCG CCACCCCCGGTCAGGCTTGG
Product: hypothetical protein
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 596; Mature: 595
Protein sequence:
>596_residues MTQSDHRHTRPSSYGGTVLTQRVSQATVEDSRPLRGWQRRAMVKYLASQPRDFLAVATPGSGKTTFALRVMTELLNSHAV EQVTVVVPTEHLKVQWTRAAATHGLALDPKFSNTNPRTSPEYHGVTMTYAQVAAHPTLHRVRTEGRRTLVIFDEIHHGGN AKAWGDAIREAFSDATRRLALTGTPFRSDDKPIPFVTYALDADGLMHSQADHTYSYAEGLADGVVRPVVFLVYSGQARWR NSAGEEHAARLGEPLSAEQTARAWRTALDPSGEWMPAVISAADQRLRQLRTHVPDAGGMIIASDQTAARAYANLLAQMTS ETPTLVLSDDPGSSARITEFAKNTSQWLIAVRMVSEGVDIPRLSVGIYATSASTPLFFAQAIGRFVRSRHPGETASIFVP SVPNLLQLASELETQRNHVLGKPHRESTDNPLGGNPATMTQTEQDDTEKYFTAIGADAELDQIIFDGSSFGTATPAGSEE EAYYLGIPGLLDADQMRALLHRRQNEQLQKRTAAQQASSTPDRTSGAPASVHGQLRELRRELNSLVSIAHHHTGKPHGWI HNELRRRCGGPPIAAATHDQLKARIDAVRQLNAEPS
Sequences:
>Translated_596_residues MTQSDHRHTRPSSYGGTVLTQRVSQATVEDSRPLRGWQRRAMVKYLASQPRDFLAVATPGSGKTTFALRVMTELLNSHAV EQVTVVVPTEHLKVQWTRAAATHGLALDPKFSNTNPRTSPEYHGVTMTYAQVAAHPTLHRVRTEGRRTLVIFDEIHHGGN AKAWGDAIREAFSDATRRLALTGTPFRSDDKPIPFVTYALDADGLMHSQADHTYSYAEGLADGVVRPVVFLVYSGQARWR NSAGEEHAARLGEPLSAEQTARAWRTALDPSGEWMPAVISAADQRLRQLRTHVPDAGGMIIASDQTAARAYANLLAQMTS ETPTLVLSDDPGSSARITEFAKNTSQWLIAVRMVSEGVDIPRLSVGIYATSASTPLFFAQAIGRFVRSRHPGETASIFVP SVPNLLQLASELETQRNHVLGKPHRESTDNPLGGNPATMTQTEQDDTEKYFTAIGADAELDQIIFDGSSFGTATPAGSEE EAYYLGIPGLLDADQMRALLHRRQNEQLQKRTAAQQASSTPDRTSGAPASVHGQLRELRRELNSLVSIAHHHTGKPHGWI HNELRRRCGGPPIAAATHDQLKARIDAVRQLNAEPS >Mature_595_residues TQSDHRHTRPSSYGGTVLTQRVSQATVEDSRPLRGWQRRAMVKYLASQPRDFLAVATPGSGKTTFALRVMTELLNSHAVE QVTVVVPTEHLKVQWTRAAATHGLALDPKFSNTNPRTSPEYHGVTMTYAQVAAHPTLHRVRTEGRRTLVIFDEIHHGGNA KAWGDAIREAFSDATRRLALTGTPFRSDDKPIPFVTYALDADGLMHSQADHTYSYAEGLADGVVRPVVFLVYSGQARWRN SAGEEHAARLGEPLSAEQTARAWRTALDPSGEWMPAVISAADQRLRQLRTHVPDAGGMIIASDQTAARAYANLLAQMTSE TPTLVLSDDPGSSARITEFAKNTSQWLIAVRMVSEGVDIPRLSVGIYATSASTPLFFAQAIGRFVRSRHPGETASIFVPS VPNLLQLASELETQRNHVLGKPHRESTDNPLGGNPATMTQTEQDDTEKYFTAIGADAELDQIIFDGSSFGTATPAGSEEE AYYLGIPGLLDADQMRALLHRRQNEQLQKRTAAQQASSTPDRTSGAPASVHGQLRELRRELNSLVSIAHHHTGKPHGWIH NELRRRCGGPPIAAATHDQLKARIDAVRQLNAEPS
Specific function: Unknown
COG id: COG1061
COG function: function code KL; DNA or RNA helicases of superfamily II
Gene ontology:
Cell location: Cytoplasmic
Metaboloic importance: NA
Operon status: Not Known
Operon components: None
Similarity: To M.tuberculosis Rv2917
Homologues:
None
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): Y1624_MYCLE (O33011)
Other databases:
- EMBL: Z97369 - EMBL: AL583922 - PIR: B87112 - RefSeq: NP_302119.1 - ProteinModelPortal: O33011 - EnsemblBacteria: EBMYCT00000028350 - GeneID: 910814 - GenomeReviews: AL450380_GR - KEGG: mle:ML1624 - NMPDR: fig|272631.1.peg.991 - Leproma: ML1624 - GeneTree: EBGT00070000032301 - HOGENOM: HBG322463 - OMA: VVAPTEH - ProtClustDB: CLSK872122 - BioCyc: MLEP272631:ML1624-MONOMER - InterPro: IPR014001 - InterPro: IPR001650 - InterPro: IPR014021 - InterPro: IPR006935 - SMART: SM00487
Pfam domain/function: PF00271 Helicase_C; PF04851 ResIII
EC number: NA
Molecular weight: Translated: 65208; Mature: 65076
Theoretical pI: Translated: 7.75; Mature: 7.75
Prosite motif: PS51192 HELICASE_ATP_BIND_1; PS51194 HELICASE_CTER
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.2 %Cys (Translated Protein) 1.8 %Met (Translated Protein) 2.0 %Cys+Met (Translated Protein) 0.2 %Cys (Mature Protein) 1.7 %Met (Mature Protein) 1.8 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MTQSDHRHTRPSSYGGTVLTQRVSQATVEDSRPLRGWQRRAMVKYLASQPRDFLAVATPG CCCCCCCCCCCCCCCCHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHCCCCEEEEECCC SGKTTFALRVMTELLNSHAVEQVTVVVPTEHLKVQWTRAAATHGLALDPKFSNTNPRTSP CCCHHHHHHHHHHHHHHHCCEEEEEEEECCCEEEEEEHHHCCCCCEECCCCCCCCCCCCC EYHGVTMTYAQVAAHPTLHRVRTEGRRTLVIFDEIHHGGNAKAWGDAIREAFSDATRRLA CCCCEEEHHHHHHHCCHHHHHHCCCCEEEEEEECCCCCCCCCHHHHHHHHHHHHHHHEEE LTGTPFRSDDKPIPFVTYALDADGLMHSQADHTYSYAEGLADGVVRPVVFLVYSGQARWR EECCCCCCCCCCCCEEEEEECCCCCHHCCCCCHHHHHHHHHHHHHHHHEEEEECCCHHHC NSAGEEHAARLGEPLSAEQTARAWRTALDPSGEWMPAVISAADQRLRQLRTHVPDAGGMI CCCCHHHHHHCCCCCCHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHCCCCCCEE IASDQTAARAYANLLAQMTSETPTLVLSDDPGSSARITEFAKNTSQWLIAVRMVSEGVDI EECCCHHHHHHHHHHHHHHCCCCEEEEECCCCCCCHHHHHHHCHHHHHHHHHHHHCCCCC PRLSVGIYATSASTPLFFAQAIGRFVRSRHPGETASIFVPSVPNLLQLASELETQRNHVL CEEEEEEEEECCCCHHHHHHHHHHHHHCCCCCCCEEEECCCCCHHHHHHHHHHHHHHHCC GKPHRESTDNPLGGNPATMTQTEQDDTEKYFTAIGADAELDQIIFDGSSFGTATPAGSEE CCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHCCCCCHHHEEECCCCCCCCCCCCCCC EAYYLGIPGLLDADQMRALLHRRQNEQLQKRTAAQQASSTPDRTSGAPASVHGQLRELRR CEEEECCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHH ELNSLVSIAHHHTGKPHGWIHNELRRRCGGPPIAAATHDQLKARIDAVRQLNAEPS HHHHHHHHHHHCCCCCCCHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHCCCCC >Mature Secondary Structure TQSDHRHTRPSSYGGTVLTQRVSQATVEDSRPLRGWQRRAMVKYLASQPRDFLAVATPG CCCCCCCCCCCCCCCHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHCCCCEEEEECCC SGKTTFALRVMTELLNSHAVEQVTVVVPTEHLKVQWTRAAATHGLALDPKFSNTNPRTSP CCCHHHHHHHHHHHHHHHCCEEEEEEEECCCEEEEEEHHHCCCCCEECCCCCCCCCCCCC EYHGVTMTYAQVAAHPTLHRVRTEGRRTLVIFDEIHHGGNAKAWGDAIREAFSDATRRLA CCCCEEEHHHHHHHCCHHHHHHCCCCEEEEEEECCCCCCCCCHHHHHHHHHHHHHHHEEE LTGTPFRSDDKPIPFVTYALDADGLMHSQADHTYSYAEGLADGVVRPVVFLVYSGQARWR EECCCCCCCCCCCCEEEEEECCCCCHHCCCCCHHHHHHHHHHHHHHHHEEEEECCCHHHC NSAGEEHAARLGEPLSAEQTARAWRTALDPSGEWMPAVISAADQRLRQLRTHVPDAGGMI CCCCHHHHHHCCCCCCHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHHHHHCCCCCCEE IASDQTAARAYANLLAQMTSETPTLVLSDDPGSSARITEFAKNTSQWLIAVRMVSEGVDI EECCCHHHHHHHHHHHHHHCCCCEEEEECCCCCCCHHHHHHHCHHHHHHHHHHHHCCCCC PRLSVGIYATSASTPLFFAQAIGRFVRSRHPGETASIFVPSVPNLLQLASELETQRNHVL CEEEEEEEEECCCCHHHHHHHHHHHHHCCCCCCCEEEECCCCCHHHHHHHHHHHHHHHCC GKPHRESTDNPLGGNPATMTQTEQDDTEKYFTAIGADAELDQIIFDGSSFGTATPAGSEE CCCCCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHCCCCCHHHEEECCCCCCCCCCCCCCC EAYYLGIPGLLDADQMRALLHRRQNEQLQKRTAAQQASSTPDRTSGAPASVHGQLRELRR CEEEECCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHH ELNSLVSIAHHHTGKPHGWIHNELRRRCGGPPIAAATHDQLKARIDAVRQLNAEPS HHHHHHHHHHHCCCCCCCHHHHHHHHHHCCCCCCCCCHHHHHHHHHHHHHHCCCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 11234002