| Definition | Mycobacterium tuberculosis F11, complete genome. |
|---|---|
| Accession | NC_009565 |
| Length | 4,424,435 |
Click here to switch to the map view.
The map label for this gene is recA
Identifier: 148823925
GI number: 148823925
Start: 3061007
End: 3063379
Strand: Reverse
Name: recA
Synonym: TBFG_12750
Alternate gene names: 148823925
Gene position: 3063379-3061007 (Counterclockwise)
Preceding gene: 148823927
Following gene: 148823924
Centisome position: 69.24
GC content: 63.25
Gene sequence:
>2373_bases ATGACGCAGACCCCCGATCGGGAAAAGGCGCTCGAGCTGGCAGTGGCCCAGATCGAGAAGAGTTACGGCAAAGGTTCGGT GATGCGCCTCGGCGACGAGGCGCGTCAGCCGATTTCGGTCATTCCGACCGGATCCATCGCACTAGACGTGGCCCTGGGCA TTGGCGGCCTGCCGCGTGGCCGGGTGATAGAGATATACGGCCCGGAGTCGTCGGGTAAGACCACCGTGGCGCTGCACGCG GTGGCCAACGCTCAGGCCGCCGGTGGTGTTGCGGCGTTCATCGACGCCGAGCACGCGCTGGATCCGGACTATGCCAAGAA GCTCGGTGTCGACACCGATTCGCTGCTGGTCAGCCAACCGGACACCGGGGAACAGGCACTCGAGATCGCCGACATGCTGA TCCGCTCGGGTGCGCTTGACATCGTGGTGATCGACTCGGTGGCGGCGCTGGTGCCGCGCGCGGAGCTCGAAGGCGAGATG GGCGACAGCCACGTCGGGCTGCAGGCCCGGCTGATGAGCCAGGCGCTGCGGAAAATGACCGGCGCGCTGAATAATTCGGG CACCACGGCGATCTTCATCAACCAGCTCCGCGACAAGATCGGAGTGATGTTCGGGTCGCCCGAGACGACAACGGGCGGAA AGGCGTTGAAGTTCTACGCGTCGGTGCGCATGGACGTGCGGCGAGTCGAGACGCTCAAGGACGGTACCAACGCGGTCGGC AACCGCACCCGGGTCAAGGTCGTCAAGAACAAGTGCCTCGCAGAGGGCACTCGGATCTTCGATCCGGTCACCGGTACAAC GCATCGCATCGAGGATGTTGTCGATGGGCGCAAGCCTATTCATGTCGTGGCTGCTGCCAAGGACGGAACGCTGCATGCGC GGCCCGTGGTGTCCTGGTTCGACCAGGGAACGCGGGATGTGATCGGGTTGCGGATCGCCGGTGGCGCCATCGTGTGGGCG ACACCCGATCACAAGGTGCTGACAGAGTACGGCTGGCGTGCCGCCGGGGAACTCCGCAAGGGAGACAGGGTGGCGCAACC GCGACGCTTCGATGGATTCGGTGACAGTGCGCCGATTCCGGCGGATCATGCCCGGCTGCTTGGCTACCTGATCGGAGATG GCAGGGATGGTTGGGTGGGGGGCAAGACTCCGATCAACTTCATCAATGTTCAGCGGGCGCTCATTGACGACGTGACGCGA ATCGCTGCGACGCTCGGTTGCGCGGCCCATCCGCAGGGGCGTATCTCACTCGCGATCGCTCATCGACCCGGTGAGCGCAA CGGTGTGGCAGACCTTTGTCAGCAGGCCGGTATCTACGGCAAGCTCGCGTGGGAGAAGACGATTCCGAATTGGTTCTTCG AGCCGGACATCGCGGCCGACATTGTCGGCAATCTGCTCTTCGGCCTGTTCGAAAGCGACGGGTGGGTGAGCCGGGAACAG ACCGGGGCACTTCGGGTCGGTTACACGACGACCTCTGAACAACTCGCGCATCAGATTCATTGGCTGCTGCTGCGGTTCGG TGTCGGGAGCACCGTTCGAGATTACGATCCGACCCAGAAGCGGCCGAGCATCGTCAACGGTCGACGGATCCAGAGCAAAC GTCAAGTGTTCGAGGTCCGGATCTCGGGTATGGATAACGTCACGGCATTCGCGGAGTCAGTTCCCATGTGGGGGCCGCGC GGTGCCGCGCTTATCCAGGCGATTCCAGAAGCCACGCAGGGGCGGCGTCGTGGATCGCAAGCGACATATCTGGCTGCAGA GATGACCGATGCCGTGCTGAATTATCTGGACGAGCGCGGCGTGACCGCGCAGGAGGCCGCGGCCATGATCGGTGTAGCTT CCGGGGACCCCCGCGGTGGAATGAAGCAGGTCTTAGGTGCCAGCCGCCTTCGTCGGGATCGCGTGCAGGCGCTCGCGGAT GCCCTGGATGACAAATTCCTGCACGACATGCTGGCGGAAGAACTCCGCTATTCCGTGATCCGAGAAGTGCTGCCAACGCG GCGGGCACGAACGTTCGACCTCGAGGTCGAGGAACTGCACACCCTCGTCGCCGAAGGGGTTGTCGTGCACAACTGTTCGC CCCCCTTCAAGCAGGCCGAGTTCGACATCCTCTACGGCAAGGGAATCAGCAGGGAGGGCTCGCTGATCGACATGGGTGTG GATCAGGGCCTCATCCGCAAGTCGGGTGCCTGGTTCACCTACGAGGGCGAGCAGCTCGGCCAGGGCAAGGAGAATGCCCG CAACTTCTTGGTGGAGAACGCCGACGTGGCTGACGAGATCGAGAAGAAGATCAAGGAAAAGCTTGGCATTGGTGCCGTGG TGACCGATGATCCCTCAAATGACGGTGTCCTGCCCGCCCCCGTCGACTTCTGA
Upstream 100 bases:
>100_bases GGTGATCATTCGGAGCAGCCGACTTGTCAGTGGCTGTCTCTAGTGTCACGGCCAACCGACCGATACCGGTCAATCGAACA CCGACCACAGGAGAGGCACC
Downstream 100 bases:
>100_bases GCGCGAAGAGCAGGCGCGGGCACTGTGCCTGCGCCTGCTCACCGCGCGATCCCGCACCCGCGCCGAGTTAGCCGGCCAGC TGGCCAAGCGCGGCTACCCC
Product: DNA recombination protein RecA
Products: NA
Alternate protein names: Recombinase A; Mbo recA intein
Number of amino acids: Translated: 790; Mature: 789
Protein sequence:
>790_residues MTQTPDREKALELAVAQIEKSYGKGSVMRLGDEARQPISVIPTGSIALDVALGIGGLPRGRVIEIYGPESSGKTTVALHA VANAQAAGGVAAFIDAEHALDPDYAKKLGVDTDSLLVSQPDTGEQALEIADMLIRSGALDIVVIDSVAALVPRAELEGEM GDSHVGLQARLMSQALRKMTGALNNSGTTAIFINQLRDKIGVMFGSPETTTGGKALKFYASVRMDVRRVETLKDGTNAVG NRTRVKVVKNKCLAEGTRIFDPVTGTTHRIEDVVDGRKPIHVVAAAKDGTLHARPVVSWFDQGTRDVIGLRIAGGAIVWA TPDHKVLTEYGWRAAGELRKGDRVAQPRRFDGFGDSAPIPADHARLLGYLIGDGRDGWVGGKTPINFINVQRALIDDVTR IAATLGCAAHPQGRISLAIAHRPGERNGVADLCQQAGIYGKLAWEKTIPNWFFEPDIAADIVGNLLFGLFESDGWVSREQ TGALRVGYTTTSEQLAHQIHWLLLRFGVGSTVRDYDPTQKRPSIVNGRRIQSKRQVFEVRISGMDNVTAFAESVPMWGPR GAALIQAIPEATQGRRRGSQATYLAAEMTDAVLNYLDERGVTAQEAAAMIGVASGDPRGGMKQVLGASRLRRDRVQALAD ALDDKFLHDMLAEELRYSVIREVLPTRRARTFDLEVEELHTLVAEGVVVHNCSPPFKQAEFDILYGKGISREGSLIDMGV DQGLIRKSGAWFTYEGEQLGQGKENARNFLVENADVADEIEKKIKEKLGIGAVVTDDPSNDGVLPAPVDF
Sequences:
>Translated_790_residues MTQTPDREKALELAVAQIEKSYGKGSVMRLGDEARQPISVIPTGSIALDVALGIGGLPRGRVIEIYGPESSGKTTVALHA VANAQAAGGVAAFIDAEHALDPDYAKKLGVDTDSLLVSQPDTGEQALEIADMLIRSGALDIVVIDSVAALVPRAELEGEM GDSHVGLQARLMSQALRKMTGALNNSGTTAIFINQLRDKIGVMFGSPETTTGGKALKFYASVRMDVRRVETLKDGTNAVG NRTRVKVVKNKCLAEGTRIFDPVTGTTHRIEDVVDGRKPIHVVAAAKDGTLHARPVVSWFDQGTRDVIGLRIAGGAIVWA TPDHKVLTEYGWRAAGELRKGDRVAQPRRFDGFGDSAPIPADHARLLGYLIGDGRDGWVGGKTPINFINVQRALIDDVTR IAATLGCAAHPQGRISLAIAHRPGERNGVADLCQQAGIYGKLAWEKTIPNWFFEPDIAADIVGNLLFGLFESDGWVSREQ TGALRVGYTTTSEQLAHQIHWLLLRFGVGSTVRDYDPTQKRPSIVNGRRIQSKRQVFEVRISGMDNVTAFAESVPMWGPR GAALIQAIPEATQGRRRGSQATYLAAEMTDAVLNYLDERGVTAQEAAAMIGVASGDPRGGMKQVLGASRLRRDRVQALAD ALDDKFLHDMLAEELRYSVIREVLPTRRARTFDLEVEELHTLVAEGVVVHNCSPPFKQAEFDILYGKGISREGSLIDMGV DQGLIRKSGAWFTYEGEQLGQGKENARNFLVENADVADEIEKKIKEKLGIGAVVTDDPSNDGVLPAPVDF >Mature_789_residues TQTPDREKALELAVAQIEKSYGKGSVMRLGDEARQPISVIPTGSIALDVALGIGGLPRGRVIEIYGPESSGKTTVALHAV ANAQAAGGVAAFIDAEHALDPDYAKKLGVDTDSLLVSQPDTGEQALEIADMLIRSGALDIVVIDSVAALVPRAELEGEMG DSHVGLQARLMSQALRKMTGALNNSGTTAIFINQLRDKIGVMFGSPETTTGGKALKFYASVRMDVRRVETLKDGTNAVGN RTRVKVVKNKCLAEGTRIFDPVTGTTHRIEDVVDGRKPIHVVAAAKDGTLHARPVVSWFDQGTRDVIGLRIAGGAIVWAT PDHKVLTEYGWRAAGELRKGDRVAQPRRFDGFGDSAPIPADHARLLGYLIGDGRDGWVGGKTPINFINVQRALIDDVTRI AATLGCAAHPQGRISLAIAHRPGERNGVADLCQQAGIYGKLAWEKTIPNWFFEPDIAADIVGNLLFGLFESDGWVSREQT GALRVGYTTTSEQLAHQIHWLLLRFGVGSTVRDYDPTQKRPSIVNGRRIQSKRQVFEVRISGMDNVTAFAESVPMWGPRG AALIQAIPEATQGRRRGSQATYLAAEMTDAVLNYLDERGVTAQEAAAMIGVASGDPRGGMKQVLGASRLRRDRVQALADA LDDKFLHDMLAEELRYSVIREVLPTRRARTFDLEVEELHTLVAEGVVVHNCSPPFKQAEFDILYGKGISREGSLIDMGVD QGLIRKSGAWFTYEGEQLGQGKENARNFLVENADVADEIEKKIKEKLGIGAVVTDDPSNDGVLPAPVDF
Specific function: PI-MboI is an endonuclease
COG id: COG1372
COG function: function code L; Intein/homing endonuclease
Gene ontology:
Cell location: Cytoplasm
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 1 DOD-type homing endonuclease domain
Homologues:
Organism=Escherichia coli, GI1789051, Length=254, Percent_Identity=65.748031496063, Blast_Score=347, Evalue=2e-96,
Paralogues:
None
Copy number: 1548 Molecules/Cell In: Growth Phase, Glucose-minimal MOPS Media. 800-1200 (L-broth) 40,000-60,000 (L-broth + Nalidixate) 4,000 Molecules/Cell In: Glucose minimal media [C]
Swissprot (AC and ID): RECA_MYCBO (P0A5U5)
Other databases:
- EMBL: BX248343 - RefSeq: NP_856402.1 - ProteinModelPortal: P0A5U5 - EnsemblBacteria: EBMYCT00000014971 - GeneID: 1091758 - GenomeReviews: BX248333_GR - KEGG: mbo:Mb2756c - GeneTree: EBGT00050000016655 - HOGENOM: HBG128036 - ProtClustDB: PRK09519 - BioCyc: MBOV233413:MB2756C-MONOMER - GO: GO:0005737 - HAMAP: MF_00268 - InterPro: IPR003593 - InterPro: IPR013765 - InterPro: IPR020584 - InterPro: IPR020588 - InterPro: IPR003586 - InterPro: IPR003587 - InterPro: IPR006142 - InterPro: IPR004042 - InterPro: IPR006141 - InterPro: IPR020587 - PANTHER: PTHR22942:SF1 - PRINTS: PR00379 - PRINTS: PR00142 - SMART: SM00382 - SMART: SM00305 - SMART: SM00306 - TIGRFAMs: TIGR01443 - TIGRFAMs: TIGR01445 - TIGRFAMs: TIGR02012
Pfam domain/function: PF00154 RecA
EC number: NA
Molecular weight: Translated: 85390; Mature: 85259
Theoretical pI: Translated: 6.37; Mature: 6.37
Prosite motif: PS50818 INTEIN_C_TER; PS50819 INTEIN_ENDONUCLEASE; PS50817 INTEIN_N_TER; PS00321 RECA_1; PS50162 RECA_2; PS50163 RECA_3
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.5 %Cys (Translated Protein) 1.9 %Met (Translated Protein) 2.4 %Cys+Met (Translated Protein) 0.5 %Cys (Mature Protein) 1.8 %Met (Mature Protein) 2.3 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MTQTPDREKALELAVAQIEKSYGKGSVMRLGDEARQPISVIPTGSIALDVALGIGGLPRG CCCCCCHHHHHHHHHHHHHHHCCCCCEEECCHHHCCCEEEECCCCEEEEEECCCCCCCCC RVIEIYGPESSGKTTVALHAVANAQAAGGVAAFIDAEHALDPDYAKKLGVDTDSLLVSQP CEEEEECCCCCCCEEEEEEEECCCCCCCCEEEEEECHHCCCHHHHHHHCCCCHHEEEECC DTGEQALEIADMLIRSGALDIVVIDSVAALVPRAELEGEMGDSHVGLQARLMSQALRKMT CCCHHHHHHHHHHHHCCCCEEEEHHHHHHHCCHHHHCCCCCCCCCCHHHHHHHHHHHHHH GALNNSGTTAIFINQLRDKIGVMFGSPETTTGGKALKFYASVRMDVRRVETLKDGTNAVG HCCCCCCCEEEEHHHHHHHHCEEECCCCCCCCCCCEEHHHHHHHHHHHHHHHHCCCHHCC NRTRVKVVKNKCLAEGTRIFDPVTGTTHRIEDVVDGRKPIHVVAAAKDGTLHARPVVSWF CCCEEHHHHHHHHHCCCEEECCCCCCHHHHHHHHCCCCCEEEEEECCCCCEECCHHHHHH DQGTRDVIGLRIAGGAIVWATPDHKVLTEYGWRAAGELRKGDRVAQPRRFDGFGDSAPIP CCCCCCEEEEEEECCEEEEECCCCHHHHHCCCHHHCCCCCCCCCCCCCCCCCCCCCCCCC ADHARLLGYLIGDGRDGWVGGKTPINFINVQRALIDDVTRIAATLGCAAHPQGRISLAIA HHHHHHHHHHEECCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCCCCCCEEEEEE HRPGERNGVADLCQQAGIYGKLAWEKTIPNWFFEPDIAADIVGNLLFGLFESDGWVSREQ ECCCCCCCHHHHHHHCCCCEEEEEHHCCCCCCCCCCHHHHHHHHHHHHHHCCCCCCCCCC TGALRVGYTTTSEQLAHQIHWLLLRFGVGSTVRDYDPTQKRPSIVNGRRIQSKRQVFEVR CCCEEEEECCCHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCHHHHHHHHEEEEE ISGMDNVTAFAESVPMWGPRGAALIQAIPEATQGRRRGSQATYLAAEMTDAVLNYLDERG ECCCCHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHCCCCCEEHHHHHHHHHHHHHHHCC VTAQEAAAMIGVASGDPRGGMKQVLGASRLRRDRVQALADALDDKFLHDMLAEELRYSVI CCHHHHHHEEEECCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH REVLPTRRARTFDLEVEELHTLVAEGVVVHNCSPPFKQAEFDILYGKGISREGSLIDMGV HHHHHCCCCEEECCCHHHHHHHHHCCEEEECCCCCCCCCCEEEEECCCCCCCCCEEEECC DQGLIRKSGAWFTYEGEQLGQGKENARNFLVENADVADEIEKKIKEKLGIGAVVTDDPSN CCCHHHCCCCEEEECCHHHCCCHHHHHHHEECCCCHHHHHHHHHHHHHCCCEEEECCCCC DGVLPAPVDF CCCCCCCCCC >Mature Secondary Structure TQTPDREKALELAVAQIEKSYGKGSVMRLGDEARQPISVIPTGSIALDVALGIGGLPRG CCCCCHHHHHHHHHHHHHHHCCCCCEEECCHHHCCCEEEECCCCEEEEEECCCCCCCCC RVIEIYGPESSGKTTVALHAVANAQAAGGVAAFIDAEHALDPDYAKKLGVDTDSLLVSQP CEEEEECCCCCCCEEEEEEEECCCCCCCCEEEEEECHHCCCHHHHHHHCCCCHHEEEECC DTGEQALEIADMLIRSGALDIVVIDSVAALVPRAELEGEMGDSHVGLQARLMSQALRKMT CCCHHHHHHHHHHHHCCCCEEEEHHHHHHHCCHHHHCCCCCCCCCCHHHHHHHHHHHHHH GALNNSGTTAIFINQLRDKIGVMFGSPETTTGGKALKFYASVRMDVRRVETLKDGTNAVG HCCCCCCCEEEEHHHHHHHHCEEECCCCCCCCCCCEEHHHHHHHHHHHHHHHHCCCHHCC NRTRVKVVKNKCLAEGTRIFDPVTGTTHRIEDVVDGRKPIHVVAAAKDGTLHARPVVSWF CCCEEHHHHHHHHHCCCEEECCCCCCHHHHHHHHCCCCCEEEEEECCCCCEECCHHHHHH DQGTRDVIGLRIAGGAIVWATPDHKVLTEYGWRAAGELRKGDRVAQPRRFDGFGDSAPIP CCCCCCEEEEEEECCEEEEECCCCHHHHHCCCHHHCCCCCCCCCCCCCCCCCCCCCCCCC ADHARLLGYLIGDGRDGWVGGKTPINFINVQRALIDDVTRIAATLGCAAHPQGRISLAIA HHHHHHHHHHEECCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCCCCCCEEEEEE HRPGERNGVADLCQQAGIYGKLAWEKTIPNWFFEPDIAADIVGNLLFGLFESDGWVSREQ ECCCCCCCHHHHHHHCCCCEEEEEHHCCCCCCCCCCHHHHHHHHHHHHHHCCCCCCCCCC TGALRVGYTTTSEQLAHQIHWLLLRFGVGSTVRDYDPTQKRPSIVNGRRIQSKRQVFEVR CCCEEEEECCCHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCHHHHHHHHEEEEE ISGMDNVTAFAESVPMWGPRGAALIQAIPEATQGRRRGSQATYLAAEMTDAVLNYLDERG ECCCCHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHCCCCCEEHHHHHHHHHHHHHHHCC VTAQEAAAMIGVASGDPRGGMKQVLGASRLRRDRVQALADALDDKFLHDMLAEELRYSVI CCHHHHHHEEEECCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH REVLPTRRARTFDLEVEELHTLVAEGVVVHNCSPPFKQAEFDILYGKGISREGSLIDMGV HHHHHCCCCEEECCCHHHHHHHHHCCEEEECCCCCCCCCCEEEEECCCCCCCCCEEEECC DQGLIRKSGAWFTYEGEQLGQGKENARNFLVENADVADEIEKKIKEKLGIGAVVTDDPSN CCCHHHCCCCEEEECCHHHCCCHHHHHHHEECCCCHHHHHHHHHHHHHCCCEEEECCCCC DGVLPAPVDF CCCCCCCCCC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 12788972