The gene/protein map for NC_009565 is currently unavailable.
Definition Mycobacterium tuberculosis F11, complete genome.
Accession NC_009565
Length 4,424,435

Click here to switch to the map view.

The map label for this gene is recA

Identifier: 148823925

GI number: 148823925

Start: 3061007

End: 3063379

Strand: Reverse

Name: recA

Synonym: TBFG_12750

Alternate gene names: 148823925

Gene position: 3063379-3061007 (Counterclockwise)

Preceding gene: 148823927

Following gene: 148823924

Centisome position: 69.24

GC content: 63.25

Gene sequence:

>2373_bases
ATGACGCAGACCCCCGATCGGGAAAAGGCGCTCGAGCTGGCAGTGGCCCAGATCGAGAAGAGTTACGGCAAAGGTTCGGT
GATGCGCCTCGGCGACGAGGCGCGTCAGCCGATTTCGGTCATTCCGACCGGATCCATCGCACTAGACGTGGCCCTGGGCA
TTGGCGGCCTGCCGCGTGGCCGGGTGATAGAGATATACGGCCCGGAGTCGTCGGGTAAGACCACCGTGGCGCTGCACGCG
GTGGCCAACGCTCAGGCCGCCGGTGGTGTTGCGGCGTTCATCGACGCCGAGCACGCGCTGGATCCGGACTATGCCAAGAA
GCTCGGTGTCGACACCGATTCGCTGCTGGTCAGCCAACCGGACACCGGGGAACAGGCACTCGAGATCGCCGACATGCTGA
TCCGCTCGGGTGCGCTTGACATCGTGGTGATCGACTCGGTGGCGGCGCTGGTGCCGCGCGCGGAGCTCGAAGGCGAGATG
GGCGACAGCCACGTCGGGCTGCAGGCCCGGCTGATGAGCCAGGCGCTGCGGAAAATGACCGGCGCGCTGAATAATTCGGG
CACCACGGCGATCTTCATCAACCAGCTCCGCGACAAGATCGGAGTGATGTTCGGGTCGCCCGAGACGACAACGGGCGGAA
AGGCGTTGAAGTTCTACGCGTCGGTGCGCATGGACGTGCGGCGAGTCGAGACGCTCAAGGACGGTACCAACGCGGTCGGC
AACCGCACCCGGGTCAAGGTCGTCAAGAACAAGTGCCTCGCAGAGGGCACTCGGATCTTCGATCCGGTCACCGGTACAAC
GCATCGCATCGAGGATGTTGTCGATGGGCGCAAGCCTATTCATGTCGTGGCTGCTGCCAAGGACGGAACGCTGCATGCGC
GGCCCGTGGTGTCCTGGTTCGACCAGGGAACGCGGGATGTGATCGGGTTGCGGATCGCCGGTGGCGCCATCGTGTGGGCG
ACACCCGATCACAAGGTGCTGACAGAGTACGGCTGGCGTGCCGCCGGGGAACTCCGCAAGGGAGACAGGGTGGCGCAACC
GCGACGCTTCGATGGATTCGGTGACAGTGCGCCGATTCCGGCGGATCATGCCCGGCTGCTTGGCTACCTGATCGGAGATG
GCAGGGATGGTTGGGTGGGGGGCAAGACTCCGATCAACTTCATCAATGTTCAGCGGGCGCTCATTGACGACGTGACGCGA
ATCGCTGCGACGCTCGGTTGCGCGGCCCATCCGCAGGGGCGTATCTCACTCGCGATCGCTCATCGACCCGGTGAGCGCAA
CGGTGTGGCAGACCTTTGTCAGCAGGCCGGTATCTACGGCAAGCTCGCGTGGGAGAAGACGATTCCGAATTGGTTCTTCG
AGCCGGACATCGCGGCCGACATTGTCGGCAATCTGCTCTTCGGCCTGTTCGAAAGCGACGGGTGGGTGAGCCGGGAACAG
ACCGGGGCACTTCGGGTCGGTTACACGACGACCTCTGAACAACTCGCGCATCAGATTCATTGGCTGCTGCTGCGGTTCGG
TGTCGGGAGCACCGTTCGAGATTACGATCCGACCCAGAAGCGGCCGAGCATCGTCAACGGTCGACGGATCCAGAGCAAAC
GTCAAGTGTTCGAGGTCCGGATCTCGGGTATGGATAACGTCACGGCATTCGCGGAGTCAGTTCCCATGTGGGGGCCGCGC
GGTGCCGCGCTTATCCAGGCGATTCCAGAAGCCACGCAGGGGCGGCGTCGTGGATCGCAAGCGACATATCTGGCTGCAGA
GATGACCGATGCCGTGCTGAATTATCTGGACGAGCGCGGCGTGACCGCGCAGGAGGCCGCGGCCATGATCGGTGTAGCTT
CCGGGGACCCCCGCGGTGGAATGAAGCAGGTCTTAGGTGCCAGCCGCCTTCGTCGGGATCGCGTGCAGGCGCTCGCGGAT
GCCCTGGATGACAAATTCCTGCACGACATGCTGGCGGAAGAACTCCGCTATTCCGTGATCCGAGAAGTGCTGCCAACGCG
GCGGGCACGAACGTTCGACCTCGAGGTCGAGGAACTGCACACCCTCGTCGCCGAAGGGGTTGTCGTGCACAACTGTTCGC
CCCCCTTCAAGCAGGCCGAGTTCGACATCCTCTACGGCAAGGGAATCAGCAGGGAGGGCTCGCTGATCGACATGGGTGTG
GATCAGGGCCTCATCCGCAAGTCGGGTGCCTGGTTCACCTACGAGGGCGAGCAGCTCGGCCAGGGCAAGGAGAATGCCCG
CAACTTCTTGGTGGAGAACGCCGACGTGGCTGACGAGATCGAGAAGAAGATCAAGGAAAAGCTTGGCATTGGTGCCGTGG
TGACCGATGATCCCTCAAATGACGGTGTCCTGCCCGCCCCCGTCGACTTCTGA

Upstream 100 bases:

>100_bases
GGTGATCATTCGGAGCAGCCGACTTGTCAGTGGCTGTCTCTAGTGTCACGGCCAACCGACCGATACCGGTCAATCGAACA
CCGACCACAGGAGAGGCACC

Downstream 100 bases:

>100_bases
GCGCGAAGAGCAGGCGCGGGCACTGTGCCTGCGCCTGCTCACCGCGCGATCCCGCACCCGCGCCGAGTTAGCCGGCCAGC
TGGCCAAGCGCGGCTACCCC

Product: DNA recombination protein RecA

Products: NA

Alternate protein names: Recombinase A; Mbo recA intein

Number of amino acids: Translated: 790; Mature: 789

Protein sequence:

>790_residues
MTQTPDREKALELAVAQIEKSYGKGSVMRLGDEARQPISVIPTGSIALDVALGIGGLPRGRVIEIYGPESSGKTTVALHA
VANAQAAGGVAAFIDAEHALDPDYAKKLGVDTDSLLVSQPDTGEQALEIADMLIRSGALDIVVIDSVAALVPRAELEGEM
GDSHVGLQARLMSQALRKMTGALNNSGTTAIFINQLRDKIGVMFGSPETTTGGKALKFYASVRMDVRRVETLKDGTNAVG
NRTRVKVVKNKCLAEGTRIFDPVTGTTHRIEDVVDGRKPIHVVAAAKDGTLHARPVVSWFDQGTRDVIGLRIAGGAIVWA
TPDHKVLTEYGWRAAGELRKGDRVAQPRRFDGFGDSAPIPADHARLLGYLIGDGRDGWVGGKTPINFINVQRALIDDVTR
IAATLGCAAHPQGRISLAIAHRPGERNGVADLCQQAGIYGKLAWEKTIPNWFFEPDIAADIVGNLLFGLFESDGWVSREQ
TGALRVGYTTTSEQLAHQIHWLLLRFGVGSTVRDYDPTQKRPSIVNGRRIQSKRQVFEVRISGMDNVTAFAESVPMWGPR
GAALIQAIPEATQGRRRGSQATYLAAEMTDAVLNYLDERGVTAQEAAAMIGVASGDPRGGMKQVLGASRLRRDRVQALAD
ALDDKFLHDMLAEELRYSVIREVLPTRRARTFDLEVEELHTLVAEGVVVHNCSPPFKQAEFDILYGKGISREGSLIDMGV
DQGLIRKSGAWFTYEGEQLGQGKENARNFLVENADVADEIEKKIKEKLGIGAVVTDDPSNDGVLPAPVDF

Sequences:

>Translated_790_residues
MTQTPDREKALELAVAQIEKSYGKGSVMRLGDEARQPISVIPTGSIALDVALGIGGLPRGRVIEIYGPESSGKTTVALHA
VANAQAAGGVAAFIDAEHALDPDYAKKLGVDTDSLLVSQPDTGEQALEIADMLIRSGALDIVVIDSVAALVPRAELEGEM
GDSHVGLQARLMSQALRKMTGALNNSGTTAIFINQLRDKIGVMFGSPETTTGGKALKFYASVRMDVRRVETLKDGTNAVG
NRTRVKVVKNKCLAEGTRIFDPVTGTTHRIEDVVDGRKPIHVVAAAKDGTLHARPVVSWFDQGTRDVIGLRIAGGAIVWA
TPDHKVLTEYGWRAAGELRKGDRVAQPRRFDGFGDSAPIPADHARLLGYLIGDGRDGWVGGKTPINFINVQRALIDDVTR
IAATLGCAAHPQGRISLAIAHRPGERNGVADLCQQAGIYGKLAWEKTIPNWFFEPDIAADIVGNLLFGLFESDGWVSREQ
TGALRVGYTTTSEQLAHQIHWLLLRFGVGSTVRDYDPTQKRPSIVNGRRIQSKRQVFEVRISGMDNVTAFAESVPMWGPR
GAALIQAIPEATQGRRRGSQATYLAAEMTDAVLNYLDERGVTAQEAAAMIGVASGDPRGGMKQVLGASRLRRDRVQALAD
ALDDKFLHDMLAEELRYSVIREVLPTRRARTFDLEVEELHTLVAEGVVVHNCSPPFKQAEFDILYGKGISREGSLIDMGV
DQGLIRKSGAWFTYEGEQLGQGKENARNFLVENADVADEIEKKIKEKLGIGAVVTDDPSNDGVLPAPVDF
>Mature_789_residues
TQTPDREKALELAVAQIEKSYGKGSVMRLGDEARQPISVIPTGSIALDVALGIGGLPRGRVIEIYGPESSGKTTVALHAV
ANAQAAGGVAAFIDAEHALDPDYAKKLGVDTDSLLVSQPDTGEQALEIADMLIRSGALDIVVIDSVAALVPRAELEGEMG
DSHVGLQARLMSQALRKMTGALNNSGTTAIFINQLRDKIGVMFGSPETTTGGKALKFYASVRMDVRRVETLKDGTNAVGN
RTRVKVVKNKCLAEGTRIFDPVTGTTHRIEDVVDGRKPIHVVAAAKDGTLHARPVVSWFDQGTRDVIGLRIAGGAIVWAT
PDHKVLTEYGWRAAGELRKGDRVAQPRRFDGFGDSAPIPADHARLLGYLIGDGRDGWVGGKTPINFINVQRALIDDVTRI
AATLGCAAHPQGRISLAIAHRPGERNGVADLCQQAGIYGKLAWEKTIPNWFFEPDIAADIVGNLLFGLFESDGWVSREQT
GALRVGYTTTSEQLAHQIHWLLLRFGVGSTVRDYDPTQKRPSIVNGRRIQSKRQVFEVRISGMDNVTAFAESVPMWGPRG
AALIQAIPEATQGRRRGSQATYLAAEMTDAVLNYLDERGVTAQEAAAMIGVASGDPRGGMKQVLGASRLRRDRVQALADA
LDDKFLHDMLAEELRYSVIREVLPTRRARTFDLEVEELHTLVAEGVVVHNCSPPFKQAEFDILYGKGISREGSLIDMGVD
QGLIRKSGAWFTYEGEQLGQGKENARNFLVENADVADEIEKKIKEKLGIGAVVTDDPSNDGVLPAPVDF

Specific function: PI-MboI is an endonuclease

COG id: COG1372

COG function: function code L; Intein/homing endonuclease

Gene ontology:

Cell location: Cytoplasm

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 DOD-type homing endonuclease domain

Homologues:

Organism=Escherichia coli, GI1789051, Length=254, Percent_Identity=65.748031496063, Blast_Score=347, Evalue=2e-96,

Paralogues:

None

Copy number: 1548 Molecules/Cell In: Growth Phase, Glucose-minimal MOPS Media. 800-1200 (L-broth) 40,000-60,000 (L-broth + Nalidixate) 4,000 Molecules/Cell In: Glucose minimal media [C]

Swissprot (AC and ID): RECA_MYCBO (P0A5U5)

Other databases:

- EMBL:   BX248343
- RefSeq:   NP_856402.1
- ProteinModelPortal:   P0A5U5
- EnsemblBacteria:   EBMYCT00000014971
- GeneID:   1091758
- GenomeReviews:   BX248333_GR
- KEGG:   mbo:Mb2756c
- GeneTree:   EBGT00050000016655
- HOGENOM:   HBG128036
- ProtClustDB:   PRK09519
- BioCyc:   MBOV233413:MB2756C-MONOMER
- GO:   GO:0005737
- HAMAP:   MF_00268
- InterPro:   IPR003593
- InterPro:   IPR013765
- InterPro:   IPR020584
- InterPro:   IPR020588
- InterPro:   IPR003586
- InterPro:   IPR003587
- InterPro:   IPR006142
- InterPro:   IPR004042
- InterPro:   IPR006141
- InterPro:   IPR020587
- PANTHER:   PTHR22942:SF1
- PRINTS:   PR00379
- PRINTS:   PR00142
- SMART:   SM00382
- SMART:   SM00305
- SMART:   SM00306
- TIGRFAMs:   TIGR01443
- TIGRFAMs:   TIGR01445
- TIGRFAMs:   TIGR02012

Pfam domain/function: PF00154 RecA

EC number: NA

Molecular weight: Translated: 85390; Mature: 85259

Theoretical pI: Translated: 6.37; Mature: 6.37

Prosite motif: PS50818 INTEIN_C_TER; PS50819 INTEIN_ENDONUCLEASE; PS50817 INTEIN_N_TER; PS00321 RECA_1; PS50162 RECA_2; PS50163 RECA_3

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.5 %Cys     (Translated Protein)
1.9 %Met     (Translated Protein)
2.4 %Cys+Met (Translated Protein)
0.5 %Cys     (Mature Protein)
1.8 %Met     (Mature Protein)
2.3 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MTQTPDREKALELAVAQIEKSYGKGSVMRLGDEARQPISVIPTGSIALDVALGIGGLPRG
CCCCCCHHHHHHHHHHHHHHHCCCCCEEECCHHHCCCEEEECCCCEEEEEECCCCCCCCC
RVIEIYGPESSGKTTVALHAVANAQAAGGVAAFIDAEHALDPDYAKKLGVDTDSLLVSQP
CEEEEECCCCCCCEEEEEEEECCCCCCCCEEEEEECHHCCCHHHHHHHCCCCHHEEEECC
DTGEQALEIADMLIRSGALDIVVIDSVAALVPRAELEGEMGDSHVGLQARLMSQALRKMT
CCCHHHHHHHHHHHHCCCCEEEEHHHHHHHCCHHHHCCCCCCCCCCHHHHHHHHHHHHHH
GALNNSGTTAIFINQLRDKIGVMFGSPETTTGGKALKFYASVRMDVRRVETLKDGTNAVG
HCCCCCCCEEEEHHHHHHHHCEEECCCCCCCCCCCEEHHHHHHHHHHHHHHHHCCCHHCC
NRTRVKVVKNKCLAEGTRIFDPVTGTTHRIEDVVDGRKPIHVVAAAKDGTLHARPVVSWF
CCCEEHHHHHHHHHCCCEEECCCCCCHHHHHHHHCCCCCEEEEEECCCCCEECCHHHHHH
DQGTRDVIGLRIAGGAIVWATPDHKVLTEYGWRAAGELRKGDRVAQPRRFDGFGDSAPIP
CCCCCCEEEEEEECCEEEEECCCCHHHHHCCCHHHCCCCCCCCCCCCCCCCCCCCCCCCC
ADHARLLGYLIGDGRDGWVGGKTPINFINVQRALIDDVTRIAATLGCAAHPQGRISLAIA
HHHHHHHHHHEECCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCCCCCCEEEEEE
HRPGERNGVADLCQQAGIYGKLAWEKTIPNWFFEPDIAADIVGNLLFGLFESDGWVSREQ
ECCCCCCCHHHHHHHCCCCEEEEEHHCCCCCCCCCCHHHHHHHHHHHHHHCCCCCCCCCC
TGALRVGYTTTSEQLAHQIHWLLLRFGVGSTVRDYDPTQKRPSIVNGRRIQSKRQVFEVR
CCCEEEEECCCHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCHHHHHHHHEEEEE
ISGMDNVTAFAESVPMWGPRGAALIQAIPEATQGRRRGSQATYLAAEMTDAVLNYLDERG
ECCCCHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHCCCCCEEHHHHHHHHHHHHHHHCC
VTAQEAAAMIGVASGDPRGGMKQVLGASRLRRDRVQALADALDDKFLHDMLAEELRYSVI
CCHHHHHHEEEECCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
REVLPTRRARTFDLEVEELHTLVAEGVVVHNCSPPFKQAEFDILYGKGISREGSLIDMGV
HHHHHCCCCEEECCCHHHHHHHHHCCEEEECCCCCCCCCCEEEEECCCCCCCCCEEEECC
DQGLIRKSGAWFTYEGEQLGQGKENARNFLVENADVADEIEKKIKEKLGIGAVVTDDPSN
CCCHHHCCCCEEEECCHHHCCCHHHHHHHEECCCCHHHHHHHHHHHHHCCCEEEECCCCC
DGVLPAPVDF
CCCCCCCCCC
>Mature Secondary Structure 
TQTPDREKALELAVAQIEKSYGKGSVMRLGDEARQPISVIPTGSIALDVALGIGGLPRG
CCCCCHHHHHHHHHHHHHHHCCCCCEEECCHHHCCCEEEECCCCEEEEEECCCCCCCCC
RVIEIYGPESSGKTTVALHAVANAQAAGGVAAFIDAEHALDPDYAKKLGVDTDSLLVSQP
CEEEEECCCCCCCEEEEEEEECCCCCCCCEEEEEECHHCCCHHHHHHHCCCCHHEEEECC
DTGEQALEIADMLIRSGALDIVVIDSVAALVPRAELEGEMGDSHVGLQARLMSQALRKMT
CCCHHHHHHHHHHHHCCCCEEEEHHHHHHHCCHHHHCCCCCCCCCCHHHHHHHHHHHHHH
GALNNSGTTAIFINQLRDKIGVMFGSPETTTGGKALKFYASVRMDVRRVETLKDGTNAVG
HCCCCCCCEEEEHHHHHHHHCEEECCCCCCCCCCCEEHHHHHHHHHHHHHHHHCCCHHCC
NRTRVKVVKNKCLAEGTRIFDPVTGTTHRIEDVVDGRKPIHVVAAAKDGTLHARPVVSWF
CCCEEHHHHHHHHHCCCEEECCCCCCHHHHHHHHCCCCCEEEEEECCCCCEECCHHHHHH
DQGTRDVIGLRIAGGAIVWATPDHKVLTEYGWRAAGELRKGDRVAQPRRFDGFGDSAPIP
CCCCCCEEEEEEECCEEEEECCCCHHHHHCCCHHHCCCCCCCCCCCCCCCCCCCCCCCCC
ADHARLLGYLIGDGRDGWVGGKTPINFINVQRALIDDVTRIAATLGCAAHPQGRISLAIA
HHHHHHHHHHEECCCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHCCCCCCCCCEEEEEE
HRPGERNGVADLCQQAGIYGKLAWEKTIPNWFFEPDIAADIVGNLLFGLFESDGWVSREQ
ECCCCCCCHHHHHHHCCCCEEEEEHHCCCCCCCCCCHHHHHHHHHHHHHHCCCCCCCCCC
TGALRVGYTTTSEQLAHQIHWLLLRFGVGSTVRDYDPTQKRPSIVNGRRIQSKRQVFEVR
CCCEEEEECCCHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCHHHHHHHHEEEEE
ISGMDNVTAFAESVPMWGPRGAALIQAIPEATQGRRRGSQATYLAAEMTDAVLNYLDERG
ECCCCHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHCCCCCEEHHHHHHHHHHHHHHHCC
VTAQEAAAMIGVASGDPRGGMKQVLGASRLRRDRVQALADALDDKFLHDMLAEELRYSVI
CCHHHHHHEEEECCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
REVLPTRRARTFDLEVEELHTLVAEGVVVHNCSPPFKQAEFDILYGKGISREGSLIDMGV
HHHHHCCCCEEECCCHHHHHHHHHCCEEEECCCCCCCCCCEEEEECCCCCCCCCEEEECC
DQGLIRKSGAWFTYEGEQLGQGKENARNFLVENADVADEIEKKIKEKLGIGAVVTDDPSN
CCCHHHCCCCEEEECCHHHCCCHHHHHHHEECCCCHHHHHHHHHHHHHCCCEEEECCCCC
DGVLPAPVDF
CCCCCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 12788972