| Definition | Mycobacterium tuberculosis F11, complete genome. |
|---|---|
| Accession | NC_009565 |
| Length | 4,424,435 |
Click here to switch to the map view.
The map label for this gene is uvrD
Identifier: 148824393
GI number: 148824393
Start: 3580874
End: 3582976
Strand: Reverse
Name: uvrD
Synonym: TBFG_13220
Alternate gene names: 148824393
Gene position: 3582976-3580874 (Counterclockwise)
Preceding gene: 148824395
Following gene: 148824392
Centisome position: 80.98
GC content: 67.43
Gene sequence:
>2103_bases ATGTCGATAGCCAGCGACCCATTGATTGCCGGGCTGGACGACCAGCAGCGCGAAGCCGTACTGGCTCCGCGTGGACCGGT GTGCGTGCTGGCCGGTGCCGGAACCGGCAAGACCCGCACCATCACTCACCGGATCGCTTCGCTGGTCGCGAGCGGTCACG TCGCCGCCGGGCAGGTGCTGGCTGTGACATTCACCCAGCGCGCGGCGGGCGAAATGCGCAGCCGGTTGCGCGCACTCGAC GCCGCGGCACGGACCGGTTCGGGCGTCGGCGCTGTGCAGGCGCTGACCTTTCACGCGGCCGCGTATCGCCAGCTGCGGTA CTTCTGGTCGCGCGTAATCGCTGACACCGGCTGGCAGCTGCTGGACAGCAAGTTCGCCGTGGTGGCCCGCGCCGCCAGCC GCACCAGGCTGCACGCCAGCACCGATGATGTGCGTGACCTGGCCGGCGAGATCGAGTGGGCCAAGGCGTCCCTGATCGGC CCCGAGGAGTATGTGACCGCAGTGGCGGCCGCACGCCGAGACCCCCCGTTGGACGCCGCGCAAATCGCGGCTGTCTACTC CGAATACGAGGCGCTCAAGGCCCGCGGCGACGGCGTCACCTTACTTGACTTCGACGACCTGTTGCTGCACACCGCGGCCG CGATTGAAAACGACGCCGCGGTGGCCGAGGAGTTCCAGGACCGGTACCGGTGTTTCGTCGTGGACGAGTACCAGGACGTC ACCCCCCTGCAGCAGCGGGTGCTCTCGGCCTGGTTGGGTGATCGGGACGACCTGACCGTCGTCGGCGACGCCAACCAGAC CATCTACTCGTTTACCGGGGCTTCGCCTCGTTTCCTACTCGACTTCTCGCGGCGGTTCCCGGACGCCGCGGTGGTGCGGC TGGAGCGTGATTACCGGTCAACTCCGCAGGTGGTGTCATTGGCTAACCGGGTGATCGCCGCCGCCCGGGGCCGTGTTGCC GGCAGCAAGCTACGGTTGTCCGGCCAGCGTGAGCCGGGTCCGGTCCCGTCGTTCCATGAGCATTCCGACGAGCCCGCCGA GGCTGCCACGGTGGCGGCGTCAATCGCCCGGTTAATCGCATCGGGCACTCCGCCATCCGAGGTAGCCATTCTCTACCGAG TCAATGCGCAGTCAGAGGTTTATGAAGAGGCGTTGACCCAGGCGGGTATCGCCTATCAGGTTCGCGGTGGCGAGGGGTTT TTCAACCGTCAGGAAATCAAGCAGGCGTTGCTTGCCTTACAGCGTGTGTCCGAACGTGATACCGATGCCGCGTTGTCCGA CGTGGTTCGCGCGGTGCTCGCACCACTGGGGCTGACGGCACAACCGCCGGTCGGCACCCGCGCCAGGGAACGCTGGGAAG CGCTCACCGCGCTGGCCGAGCTGGTCGACGACGAGCTGGCGCAGCGTCCCGCACTGCAGCTGCCAGGCCTGCTTGCCGAG CTACGCCGGCGGGCGGAGGCGCGGCACCCACCGGTGGTGCAGGGCGTCACGCTGGCCTCACTGCACGCCGCCAAGGGACT GGAATGGGACGCGGTGTTCCTGGTCGGATTGGCTGACGGCACGCTGCCCATCTCACATGCGCTGGCACACGGCCCCAATA GCGAGCCCGTAGAGGAAGAGCGTCGGCTGCTCTACGTCGGAATCACACGGGCCCGAGTCCATTTGGCGCTCAGCTGGGCG CTATCACGGTCCCCGGGCGGGCGCCAGAGCCGCAAGCCCTCGCGGTTCCTCAACGGCATTGCGCCGCAGACGCGCGCCGA TCCGGTGCCGGGCACATCCCGACGCAACCGGGGCGCCGCAGCGCGCTGCCGGATCTGTAACAACGAGCTGAACACTTCGG CGGCCGTCATGCTGCGGCGGTGTGAGACGTGTGCAGCCGACGTCGACGAGGAGTTGTTGTTGCAGCTCAAGTCCTGGCGT CTGAGCACCGCCAAGGAACAGAACGTCCCCGCCTATGTCGTTTTCACCGACAACACCCTGATCGCGATCGCCGAGCTGCT ACCTACCGACGACGCGGCGCTGATCGCGATCCCCGGCATCGGTGCCCGCAAGCTGGAACAATACGGATCGGACGTGCTGC AGCTGGTTCGCGGTCGGACCTGA
Upstream 100 bases:
>100_bases CGACCCGGGCGGTGTGGCGGCTCGGCAGTTGTTCATGTCGCACGCCCCACGGCGTGGCGACACGCCCGGTCTGTCATCTA CCGCTGCCAAGATGGACGTC
Downstream 100 bases:
>100_bases ACCGGGCCTGTACCGGCAAACGCGCAGGTCAGAAAATCGGTTGTGGTCAGCTGCTGCCACCGGTTAACCTCCAGGTCGCA TTCTGCTGCCAGCCTGGAGA
Product: ATP-dependent DNA helicase II uvrD2
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 700; Mature: 699
Protein sequence:
>700_residues MSIASDPLIAGLDDQQREAVLAPRGPVCVLAGAGTGKTRTITHRIASLVASGHVAAGQVLAVTFTQRAAGEMRSRLRALD AAARTGSGVGAVQALTFHAAAYRQLRYFWSRVIADTGWQLLDSKFAVVARAASRTRLHASTDDVRDLAGEIEWAKASLIG PEEYVTAVAAARRDPPLDAAQIAAVYSEYEALKARGDGVTLLDFDDLLLHTAAAIENDAAVAEEFQDRYRCFVVDEYQDV TPLQQRVLSAWLGDRDDLTVVGDANQTIYSFTGASPRFLLDFSRRFPDAAVVRLERDYRSTPQVVSLANRVIAAARGRVA GSKLRLSGQREPGPVPSFHEHSDEPAEAATVAASIARLIASGTPPSEVAILYRVNAQSEVYEEALTQAGIAYQVRGGEGF FNRQEIKQALLALQRVSERDTDAALSDVVRAVLAPLGLTAQPPVGTRARERWEALTALAELVDDELAQRPALQLPGLLAE LRRRAEARHPPVVQGVTLASLHAAKGLEWDAVFLVGLADGTLPISHALAHGPNSEPVEEERRLLYVGITRARVHLALSWA LSRSPGGRQSRKPSRFLNGIAPQTRADPVPGTSRRNRGAAARCRICNNELNTSAAVMLRRCETCAADVDEELLLQLKSWR LSTAKEQNVPAYVVFTDNTLIAIAELLPTDDAALIAIPGIGARKLEQYGSDVLQLVRGRT
Sequences:
>Translated_700_residues MSIASDPLIAGLDDQQREAVLAPRGPVCVLAGAGTGKTRTITHRIASLVASGHVAAGQVLAVTFTQRAAGEMRSRLRALD AAARTGSGVGAVQALTFHAAAYRQLRYFWSRVIADTGWQLLDSKFAVVARAASRTRLHASTDDVRDLAGEIEWAKASLIG PEEYVTAVAAARRDPPLDAAQIAAVYSEYEALKARGDGVTLLDFDDLLLHTAAAIENDAAVAEEFQDRYRCFVVDEYQDV TPLQQRVLSAWLGDRDDLTVVGDANQTIYSFTGASPRFLLDFSRRFPDAAVVRLERDYRSTPQVVSLANRVIAAARGRVA GSKLRLSGQREPGPVPSFHEHSDEPAEAATVAASIARLIASGTPPSEVAILYRVNAQSEVYEEALTQAGIAYQVRGGEGF FNRQEIKQALLALQRVSERDTDAALSDVVRAVLAPLGLTAQPPVGTRARERWEALTALAELVDDELAQRPALQLPGLLAE LRRRAEARHPPVVQGVTLASLHAAKGLEWDAVFLVGLADGTLPISHALAHGPNSEPVEEERRLLYVGITRARVHLALSWA LSRSPGGRQSRKPSRFLNGIAPQTRADPVPGTSRRNRGAAARCRICNNELNTSAAVMLRRCETCAADVDEELLLQLKSWR LSTAKEQNVPAYVVFTDNTLIAIAELLPTDDAALIAIPGIGARKLEQYGSDVLQLVRGRT >Mature_699_residues SIASDPLIAGLDDQQREAVLAPRGPVCVLAGAGTGKTRTITHRIASLVASGHVAAGQVLAVTFTQRAAGEMRSRLRALDA AARTGSGVGAVQALTFHAAAYRQLRYFWSRVIADTGWQLLDSKFAVVARAASRTRLHASTDDVRDLAGEIEWAKASLIGP EEYVTAVAAARRDPPLDAAQIAAVYSEYEALKARGDGVTLLDFDDLLLHTAAAIENDAAVAEEFQDRYRCFVVDEYQDVT PLQQRVLSAWLGDRDDLTVVGDANQTIYSFTGASPRFLLDFSRRFPDAAVVRLERDYRSTPQVVSLANRVIAAARGRVAG SKLRLSGQREPGPVPSFHEHSDEPAEAATVAASIARLIASGTPPSEVAILYRVNAQSEVYEEALTQAGIAYQVRGGEGFF NRQEIKQALLALQRVSERDTDAALSDVVRAVLAPLGLTAQPPVGTRARERWEALTALAELVDDELAQRPALQLPGLLAEL RRRAEARHPPVVQGVTLASLHAAKGLEWDAVFLVGLADGTLPISHALAHGPNSEPVEEERRLLYVGITRARVHLALSWAL SRSPGGRQSRKPSRFLNGIAPQTRADPVPGTSRRNRGAAARCRICNNELNTSAAVMLRRCETCAADVDEELLLQLKSWRL STAKEQNVPAYVVFTDNTLIAIAELLPTDDAALIAIPGIGARKLEQYGSDVLQLVRGRT
Specific function: Has both ATPase and helicase activities. Unwinds DNA duplexes with 3' to 5' polarity with respect to the bound strand and initiates unwinding most effectively when a single-stranded region is present. Involved in the post-incision events of nucleotide exc
COG id: COG0210
COG function: function code L; Superfamily I DNA and RNA helicases
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 1 uvrD-like helicase C-terminal domain
Homologues:
Organism=Escherichia coli, GI2367296, Length=476, Percent_Identity=34.6638655462185, Blast_Score=219, Evalue=6e-58, Organism=Escherichia coli, GI48994965, Length=659, Percent_Identity=30.1972685887709, Blast_Score=181, Evalue=1e-46, Organism=Escherichia coli, GI48994977, Length=76, Percent_Identity=39.4736842105263, Blast_Score=68, Evalue=2e-12, Organism=Saccharomyces cerevisiae, GI6322369, Length=517, Percent_Identity=25.9187620889749, Blast_Score=132, Evalue=2e-31, Organism=Saccharomyces cerevisiae, GI6324477, Length=388, Percent_Identity=21.9072164948454, Blast_Score=99, Evalue=3e-21,
Paralogues:
None
Copy number: 3000 [C]
Swissprot (AC and ID): UVRD_MYCBO (P64321)
Other databases:
- EMBL: BX248345 - RefSeq: NP_856867.1 - ProteinModelPortal: P64321 - EnsemblBacteria: EBMYCT00000016706 - GeneID: 1094074 - GenomeReviews: BX248333_GR - KEGG: mbo:Mb3222c - GeneTree: EBGT00050000015808 - HOGENOM: HBG467281 - OMA: ITRRIAH - ProtClustDB: CLSK872151 - BioCyc: MBOV233413:MB3222C-MONOMER - GO: GO:0005622 - InterPro: IPR014017 - InterPro: IPR000212 - InterPro: IPR002121 - InterPro: IPR014016 - InterPro: IPR010997 - PANTHER: PTHR11070 - SMART: SM00341
Pfam domain/function: PF00570 HRDC; PF00580 UvrD-helicase; SSF47819 HRDC_like
EC number: =3.6.4.12
Molecular weight: Translated: 75604; Mature: 75473
Theoretical pI: Translated: 6.96; Mature: 6.96
Prosite motif: PS50967 HRDC; PS51198 UVRD_HELICASE_ATP_BIND; PS51217 UVRD_HELICASE_CTER
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.9 %Cys (Translated Protein) 0.4 %Met (Translated Protein) 1.3 %Cys+Met (Translated Protein) 0.9 %Cys (Mature Protein) 0.3 %Met (Mature Protein) 1.1 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MSIASDPLIAGLDDQQREAVLAPRGPVCVLAGAGTGKTRTITHRIASLVASGHVAAGQVL CCCCCCCCEECCCCHHCCEEECCCCCEEEEECCCCCCCHHHHHHHHHHHHCCCCCCCCEE AVTFTQRAAGEMRSRLRALDAAARTGSGVGAVQALTFHAAAYRQLRYFWSRVIADTGWQL EEEEHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHH LDSKFAVVARAASRTRLHASTDDVRDLAGEIEWAKASLIGPEEYVTAVAAARRDPPLDAA HHHHHHHHHHHHHHCEECCCHHHHHHHHCCCHHHHHHCCCHHHHHHHHHHHCCCCCCCHH QIAAVYSEYEALKARGDGVTLLDFDDLLLHTAAAIENDAAVAEEFQDRYRCFVVDEYQDV HHHHHHHHHHHHHHCCCCEEEEEHHHHHHHHHHHHCCHHHHHHHHHHCCEEEEEECCCCC TPLQQRVLSAWLGDRDDLTVVGDANQTIYSFTGASPRFLLDFSRRFPDAAVVRLERDYRS CHHHHHHHHHHCCCCCCEEEEECCCCEEEEECCCCCCEEHHHHHHCCCHHEEEEHHHCCC TPQVVSLANRVIAAARGRVAGSKLRLSGQREPGPVPSFHEHSDEPAEAATVAASIARLIA CHHHHHHHHHHHHHHCCCCCCCEEEECCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHH SGTPPSEVAILYRVNAQSEVYEEALTQAGIAYQVRGGEGFFNRQEIKQALLALQRVSERD CCCCCCCEEEEEEECCHHHHHHHHHHHCCCEEEEECCCCCCCHHHHHHHHHHHHHHHCCC TDAALSDVVRAVLAPLGLTAQPPVGTRARERWEALTALAELVDDELAQRPALQLPGLLAE HHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHH LRRRAEARHPPVVQGVTLASLHAAKGLEWDAVFLVGLADGTLPISHALAHGPNSEPVEEE HHHHHHCCCCCCCCCCHHHHHHHHCCCCCCEEEEEEECCCCCHHHHHHHCCCCCCCHHHC RRLLYVGITRARVHLALSWALSRSPGGRQSRKPSRFLNGIAPQTRADPVPGTSRRNRGAA CCEEEEEEEHHHEEEEEEEHHCCCCCCCCCCCHHHHHHCCCCCCCCCCCCCCCCCCCCCH ARCRICNNELNTSAAVMLRRCETCAADVDEELLLQLKSWRLSTAKEQNVPAYVVFTDNTL HHHEECCCCCCHHHHHHHHHHHHHHHCCCHHHHHHHHHHHCCCCCCCCCCEEEEEECCHH IAIAELLPTDDAALIAIPGIGARKLEQYGSDVLQLVRGRT HHHHHHCCCCCCEEEEECCCCHHHHHHHHHHHHHHHHCCC >Mature Secondary Structure SIASDPLIAGLDDQQREAVLAPRGPVCVLAGAGTGKTRTITHRIASLVASGHVAAGQVL CCCCCCCEECCCCHHCCEEECCCCCEEEEECCCCCCCHHHHHHHHHHHHCCCCCCCCEE AVTFTQRAAGEMRSRLRALDAAARTGSGVGAVQALTFHAAAYRQLRYFWSRVIADTGWQL EEEEHHHHHHHHHHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHCCHHH LDSKFAVVARAASRTRLHASTDDVRDLAGEIEWAKASLIGPEEYVTAVAAARRDPPLDAA HHHHHHHHHHHHHHCEECCCHHHHHHHHCCCHHHHHHCCCHHHHHHHHHHHCCCCCCCHH QIAAVYSEYEALKARGDGVTLLDFDDLLLHTAAAIENDAAVAEEFQDRYRCFVVDEYQDV HHHHHHHHHHHHHHCCCCEEEEEHHHHHHHHHHHHCCHHHHHHHHHHCCEEEEEECCCCC TPLQQRVLSAWLGDRDDLTVVGDANQTIYSFTGASPRFLLDFSRRFPDAAVVRLERDYRS CHHHHHHHHHHCCCCCCEEEEECCCCEEEEECCCCCCEEHHHHHHCCCHHEEEEHHHCCC TPQVVSLANRVIAAARGRVAGSKLRLSGQREPGPVPSFHEHSDEPAEAATVAASIARLIA CHHHHHHHHHHHHHHCCCCCCCEEEECCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHHH SGTPPSEVAILYRVNAQSEVYEEALTQAGIAYQVRGGEGFFNRQEIKQALLALQRVSERD CCCCCCCEEEEEEECCHHHHHHHHHHHCCCEEEEECCCCCCCHHHHHHHHHHHHHHHCCC TDAALSDVVRAVLAPLGLTAQPPVGTRARERWEALTALAELVDDELAQRPALQLPGLLAE HHHHHHHHHHHHHHHCCCCCCCCCCCHHHHHHHHHHHHHHHHHHHHHCCCCCCCCHHHHH LRRRAEARHPPVVQGVTLASLHAAKGLEWDAVFLVGLADGTLPISHALAHGPNSEPVEEE HHHHHHCCCCCCCCCCHHHHHHHHCCCCCCEEEEEEECCCCCHHHHHHHCCCCCCCHHHC RRLLYVGITRARVHLALSWALSRSPGGRQSRKPSRFLNGIAPQTRADPVPGTSRRNRGAA CCEEEEEEEHHHEEEEEEEHHCCCCCCCCCCCHHHHHHCCCCCCCCCCCCCCCCCCCCCH ARCRICNNELNTSAAVMLRRCETCAADVDEELLLQLKSWRLSTAKEQNVPAYVVFTDNTL HHHEECCCCCCHHHHHHHHHHHHHHHCCCHHHHHHHHHHHCCCCCCCCCCEEEEEECCHH IAIAELLPTDDAALIAIPGIGARKLEQYGSDVLQLVRGRT HHHHHHCCCCCCEEEEECCCCHHHHHHHHHHHHHHHHCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 12788972