| Definition | Mycobacterium bovis BCG str. Pasteur 1173P2, complete genome. |
|---|---|
| Accession | NC_008769 |
| Length | 4,374,522 |
Click here to switch to the map view.
The map label for this gene is uvrD1
Identifier: 121636874
GI number: 121636874
Start: 1088737
End: 1091052
Strand: Direct
Name: uvrD1
Synonym: BCG_1003
Alternate gene names: 121636874
Gene position: 1088737-1091052 (Clockwise)
Preceding gene: 121636870
Following gene: 121636876
Centisome position: 24.89
GC content: 65.2
Gene sequence:
>2316_bases ATGAGTGTGCACGCGACCGACGCCAAGCCTCCCGGTCCATCCCCAGCGGACCAACTGCTCGACGGCCTCAACCCGCAACA GCGCCAGGCGGTCGTGCATGAGGGTTCGCCGCTGCTGATCGTCGCGGGCGCGGGTTCGGGTAAGACCGCGGTGTTGACCC GCCGCATTGCCTATCTGATGGCGGCCCGCGGCGTCGGGGTGGGCCAGATTCTGGCCATCACCTTCACCAACAAAGCCGCC GCCGAGATGCGCGAACGGGTGGTGGGCCTGGTTGGGGAGAAGGCCCGGTACATGTGGGTGTCGACGTTTCACTCCACCTG CGTGCGTATCCTGCGCAACCAGGCGGCGCTGATCGAGGGCCTCAACTCCAACTTTTCGATCTATGACGCCGACGATTCGC GGCGGTTGCTGCAGATGGTGGGCCGCGACCTGGGCCTAGACATCAAGCGGTACTCGCCGCGACTGCTGGCTAACGCCATC TCCAACCTGAAGAACGAGTTGATCGACCCGCATCAGGCGCTGGCCGGCTTAACGGAGGACTCCGATGACCTAGCGCGCGC CGTGGCGTCGGTTTATGACGAATACCAGCGGCGGCTGCGGGCGGCCAACGCGCTGGACTTCGACGACCTGATCGGCGAGA CCGTCGCGGTGCTGCAGGCCTTCCCGCAGATCGCCCAGTACTACCGTCGGAGGTTCCGGCATGTCCTGGTTGACGAATAC CAGGACACCAACCACGCCCAGTACGTATTGGTGCGCGAGCTGGTCGGCCGCGACAGCAATGACGGTATTCCCCCCGGCGA GTTGTGCGTCGTCGGGGATGCCGATCAGTCGATCTATGCGTTCCGCGGCGCCACCATCCGCAACATCGAAGACTTCGAAC GTGACTACCCCGACACCAGAACCATTCTGCTGGAACAGAATTACCGCTCGACGCAGAACATCCTGTCGGCGGCCAACTCG GTGATTGCCCGTAACGCGGGGCGCCGGGAGAAGCGGTTGTGGACCGACGCCGGCGCCGGGGAGTTGATCGTTGGCTATGT CGCCGACAACGAGCACGACGAGGCCCGGTTCGTGGCCGAGGAGATCGATGCGCTCGCCGAGGGTAGCGAGATCACCTACA ACGATGTCGCCGTCTTCTACCGCACCAACAACTCGTCGCGGTCACTGGAAGAGGTGCTGATCCGCGCCGGTATTCCGTAC AAGGTCGTTGGGGGAGTGCGCTTTTACGAGCGCAAGGAGATTCGCGACATCGTTGCCTACCTGCGCGTGCTGGACAACCC GGGCGACGCGGTCAGCCTACGGCGCATCCTTAACACCCCGCGCCGCGGTATCGGGGATCGTGCCGAGGCGTGTGTGGCGG TGTACGCCGAGAACACCGGCGTCGGCTTCGGTGACGCGCTCGTCGCCGCGGCCCAAGGCAAAGTACCGATGCTGAATACC CGGGCGGAGAAGGCGATCGCGGGTTTCGTCGAGATGTTCGACGAGCTGCGGGGCCGCCTCGATGACGACCTGGGGGAGCT GGTCGAGGCGGTGCTGGAACGCACCGGATACCGCCGCGAGCTGGAAGCGTCCACCGATCCACAGGAATTGGCCCGCCTGG ACAACCTCAACGAATTAGTCAGCGTCGCACACGAATTCAGTACCGACCGGGAGAATGCCGCCGCACTTGGCCCAGACGAC GAAGACGTCCCCGACACCGGTGTGCTGGCGGATTTTCTGGAACGGGTGTCGCTGGTCGCCGACGCCGATGAGATCCCGGA GCATGGCGCGGGTGTGGTTACCTTGATGACCTTGCACACCGCCAAGGGTTTGGAGTTCCCGGTGGTGTTTGTGACCGGCT GGGAGGACGGGATGTTCCCGCACATGCGGGCGTTGGACAACCCGACCGAGTTGTCCGAGGAGCGGCGGCTGGCCTATGTC GGCATCACCCGCGCCCGGCAGCGGTTGTACGTGAGCCGGGCGATCGTGCGTTCGTCTTGGGGCCAGCCGATGCTCAACCC GGAGTCGCGGTTTCTGCGGGAAATCCCGCAGGAGCTCATCGACTGGCGGCGCACCGCCCCGAAGCCGTCGTTCAGTGCCC CGGTGAGTGGCGCCGGTCGGTTCGGTAGCGCGCGTCCATCACCGACCCGCTCGGGGGCGAGCAGGCGCCCGCTGCTGGTG CTTCAGGTCGGCGACCGCGTGACCCATGACAAATACGGCCTGGGCCGTGTCGAGGAGGTCTCCGGTGTCGGCGAATCGGC GATGTCGCTGATCGACTTCGGTAGCTCGGGGCGGGTGAAGCTGATGCACAACCACGCCCCTGTCACCAAGCTCTGA
Upstream 100 bases:
>100_bases GGGTGGTGGCGCCGAAGGACCTGCCGCGTGGCGATGAGCCTGGCCAGGCTATGCCGCGGTCCGCCGACTCGTCGCCGCGC GGCGGTAAGTTTGGACCGAC
Downstream 100 bases:
>100_bases GATTTCGCGCCGAGCGTGAAGTCACGGCGGCTATTTCGCGGATTTCTCGCCCTGAGAACACGTTCGGCGTCGTTGCCGGG TCAACCGGTGTAATTGCCGA
Product: putative ATP dependent DNA helicase uvrD1
Products: NA
Alternate protein names: NA
Number of amino acids: Translated: 771; Mature: 770
Protein sequence:
>771_residues MSVHATDAKPPGPSPADQLLDGLNPQQRQAVVHEGSPLLIVAGAGSGKTAVLTRRIAYLMAARGVGVGQILAITFTNKAA AEMRERVVGLVGEKARYMWVSTFHSTCVRILRNQAALIEGLNSNFSIYDADDSRRLLQMVGRDLGLDIKRYSPRLLANAI SNLKNELIDPHQALAGLTEDSDDLARAVASVYDEYQRRLRAANALDFDDLIGETVAVLQAFPQIAQYYRRRFRHVLVDEY QDTNHAQYVLVRELVGRDSNDGIPPGELCVVGDADQSIYAFRGATIRNIEDFERDYPDTRTILLEQNYRSTQNILSAANS VIARNAGRREKRLWTDAGAGELIVGYVADNEHDEARFVAEEIDALAEGSEITYNDVAVFYRTNNSSRSLEEVLIRAGIPY KVVGGVRFYERKEIRDIVAYLRVLDNPGDAVSLRRILNTPRRGIGDRAEACVAVYAENTGVGFGDALVAAAQGKVPMLNT RAEKAIAGFVEMFDELRGRLDDDLGELVEAVLERTGYRRELEASTDPQELARLDNLNELVSVAHEFSTDRENAAALGPDD EDVPDTGVLADFLERVSLVADADEIPEHGAGVVTLMTLHTAKGLEFPVVFVTGWEDGMFPHMRALDNPTELSEERRLAYV GITRARQRLYVSRAIVRSSWGQPMLNPESRFLREIPQELIDWRRTAPKPSFSAPVSGAGRFGSARPSPTRSGASRRPLLV LQVGDRVTHDKYGLGRVEEVSGVGESAMSLIDFGSSGRVKLMHNHAPVTKL
Sequences:
>Translated_771_residues MSVHATDAKPPGPSPADQLLDGLNPQQRQAVVHEGSPLLIVAGAGSGKTAVLTRRIAYLMAARGVGVGQILAITFTNKAA AEMRERVVGLVGEKARYMWVSTFHSTCVRILRNQAALIEGLNSNFSIYDADDSRRLLQMVGRDLGLDIKRYSPRLLANAI SNLKNELIDPHQALAGLTEDSDDLARAVASVYDEYQRRLRAANALDFDDLIGETVAVLQAFPQIAQYYRRRFRHVLVDEY QDTNHAQYVLVRELVGRDSNDGIPPGELCVVGDADQSIYAFRGATIRNIEDFERDYPDTRTILLEQNYRSTQNILSAANS VIARNAGRREKRLWTDAGAGELIVGYVADNEHDEARFVAEEIDALAEGSEITYNDVAVFYRTNNSSRSLEEVLIRAGIPY KVVGGVRFYERKEIRDIVAYLRVLDNPGDAVSLRRILNTPRRGIGDRAEACVAVYAENTGVGFGDALVAAAQGKVPMLNT RAEKAIAGFVEMFDELRGRLDDDLGELVEAVLERTGYRRELEASTDPQELARLDNLNELVSVAHEFSTDRENAAALGPDD EDVPDTGVLADFLERVSLVADADEIPEHGAGVVTLMTLHTAKGLEFPVVFVTGWEDGMFPHMRALDNPTELSEERRLAYV GITRARQRLYVSRAIVRSSWGQPMLNPESRFLREIPQELIDWRRTAPKPSFSAPVSGAGRFGSARPSPTRSGASRRPLLV LQVGDRVTHDKYGLGRVEEVSGVGESAMSLIDFGSSGRVKLMHNHAPVTKL >Mature_770_residues SVHATDAKPPGPSPADQLLDGLNPQQRQAVVHEGSPLLIVAGAGSGKTAVLTRRIAYLMAARGVGVGQILAITFTNKAAA EMRERVVGLVGEKARYMWVSTFHSTCVRILRNQAALIEGLNSNFSIYDADDSRRLLQMVGRDLGLDIKRYSPRLLANAIS NLKNELIDPHQALAGLTEDSDDLARAVASVYDEYQRRLRAANALDFDDLIGETVAVLQAFPQIAQYYRRRFRHVLVDEYQ DTNHAQYVLVRELVGRDSNDGIPPGELCVVGDADQSIYAFRGATIRNIEDFERDYPDTRTILLEQNYRSTQNILSAANSV IARNAGRREKRLWTDAGAGELIVGYVADNEHDEARFVAEEIDALAEGSEITYNDVAVFYRTNNSSRSLEEVLIRAGIPYK VVGGVRFYERKEIRDIVAYLRVLDNPGDAVSLRRILNTPRRGIGDRAEACVAVYAENTGVGFGDALVAAAQGKVPMLNTR AEKAIAGFVEMFDELRGRLDDDLGELVEAVLERTGYRRELEASTDPQELARLDNLNELVSVAHEFSTDRENAAALGPDDE DVPDTGVLADFLERVSLVADADEIPEHGAGVVTLMTLHTAKGLEFPVVFVTGWEDGMFPHMRALDNPTELSEERRLAYVG ITRARQRLYVSRAIVRSSWGQPMLNPESRFLREIPQELIDWRRTAPKPSFSAPVSGAGRFGSARPSPTRSGASRRPLLVL QVGDRVTHDKYGLGRVEEVSGVGESAMSLIDFGSSGRVKLMHNHAPVTKL
Specific function: Has Both Atpase And Helicase Activities. Unwinds DNA Duplexes With 3' To 5' Polarity With Respect To The Bound Strand And Initiates Unwinding Most Effectively When A Single-Stranded Region Is Present. Involved In The Post-Incision Events Of Nucleotide Exc
COG id: COG0210
COG function: function code L; Superfamily I DNA and RNA helicases
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Contains 1 uvrD-like helicase C-terminal domain
Homologues:
Organism=Escherichia coli, GI2367296, Length=740, Percent_Identity=40, Blast_Score=474, Evalue=1e-135, Organism=Escherichia coli, GI48994965, Length=671, Percent_Identity=38.8971684053651, Blast_Score=384, Evalue=1e-107, Organism=Escherichia coli, GI1787196, Length=343, Percent_Identity=27.4052478134111, Blast_Score=97, Evalue=3e-21, Organism=Saccharomyces cerevisiae, GI6322369, Length=762, Percent_Identity=29.6587926509186, Blast_Score=239, Evalue=1e-63, Organism=Saccharomyces cerevisiae, GI6324477, Length=683, Percent_Identity=22.98682284041, Blast_Score=122, Evalue=2e-28,
Paralogues:
None
Copy number: 3000 [C]
Swissprot (AC and ID): PCRA_MYCBO (P0A5A4)
Other databases:
- EMBL: BX248337 - RefSeq: NP_854631.1 - ProteinModelPortal: P0A5A4 - SMR: P0A5A4 - EnsemblBacteria: EBMYCT00000014960 - GeneID: 1093055 - GenomeReviews: BX248333_GR - KEGG: mbo:Mb0974 - GeneTree: EBGT00050000015808 - HOGENOM: HBG467281 - OMA: GIKWLIA - ProtClustDB: CLSK799345 - BioCyc: MBOV233413:MB0974-MONOMER - GO: GO:0005737 - InterPro: IPR005751 - InterPro: IPR013986 - InterPro: IPR014017 - InterPro: IPR000212 - InterPro: IPR014016 - Gene3D: G3DSA:1.10.10.160 - PANTHER: PTHR11070 - TIGRFAMs: TIGR01073
Pfam domain/function: PF00580 UvrD-helicase
EC number: =3.6.4.12
Molecular weight: Translated: 85051; Mature: 84920
Theoretical pI: Translated: 5.21; Mature: 5.21
Prosite motif: PS51198 UVRD_HELICASE_ATP_BIND; PS51217 UVRD_HELICASE_CTER
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.4 %Cys (Translated Protein) 1.7 %Met (Translated Protein) 2.1 %Cys+Met (Translated Protein) 0.4 %Cys (Mature Protein) 1.6 %Met (Mature Protein) 1.9 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MSVHATDAKPPGPSPADQLLDGLNPQQRQAVVHEGSPLLIVAGAGSGKTAVLTRRIAYLM CCCCCCCCCCCCCCCHHHHHHCCCHHHHHHHHCCCCCEEEEEECCCCCHHHHHHHHHHHH AARGVGVGQILAITFTNKAAAEMRERVVGLVGEKARYMWVSTFHSTCVRILRNQAALIEG HHCCCCCCEEEEEEECCHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHC LNSNFSIYDADDSRRLLQMVGRDLGLDIKRYSPRLLANAISNLKNELIDPHQALAGLTED CCCCCEEEECCHHHHHHHHHCHHHCCCHHHCCHHHHHHHHHHHHHHHCCHHHHHHCCCCC SDDLARAVASVYDEYQRRLRAANALDFDDLIGETVAVLQAFPQIAQYYRRRFRHVLVDEY HHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH QDTNHAQYVLVRELVGRDSNDGIPPGELCVVGDADQSIYAFRGATIRNIEDFERDYPDTR CCCCCHHHHHHHHHHCCCCCCCCCCCCEEEEECCCCCEEEECCCCCCCHHHHHHCCCCCE TILLEQNYRSTQNILSAANSVIARNAGRREKRLWTDAGAGELIVGYVADNEHDEARFVAE EEEEECCCHHHHHHHHHHHHHHHHCCCCHHHHHCCCCCCCCEEEEEECCCCCHHHHHHHH EIDALAEGSEITYNDVAVFYRTNNSSRSLEEVLIRAGIPYKVVGGVRFYERKEIRDIVAY HHHHHHCCCCEEECCEEEEEEECCCCHHHHHHHHHCCCCEEEECCCHHHHHHHHHHHHHH LRVLDNPGDAVSLRRILNTPRRGIGDRAEACVAVYAENTGVGFGDALVAAAQGKVPMLNT HHHHCCCCCHHHHHHHHCCCCCCCCCHHHHEEEEEECCCCCCCCHHHHHHCCCCCCCCCC RAEKAIAGFVEMFDELRGRLDDDLGELVEAVLERTGYRRELEASTDPQELARLDNLNELV HHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHCCCCEECCCCCCHHHHHHHHCHHHHH SVAHEFSTDRENAAALGPDDEDVPDTGVLADFLERVSLVADADEIPEHGAGVVTLMTLHT HHHHHHCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHCHHHCCCCCCCEEEEEEEHH AKGLEFPVVFVTGWEDGMFPHMRALDNPTELSEERRLAYVGITRARQRLYVSRAIVRSSW CCCCCCCEEEEECCCCCCCHHHHHCCCCHHHHHHHCEEEEEHHHHHHHHHHHHHHHHHCC GQPMLNPESRFLREIPQELIDWRRTAPKPSFSAPVSGAGRFGSARPSPTRSGASRRPLLV CCCCCCHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCEEE LQVGDRVTHDKYGLGRVEEVSGVGESAMSLIDFGSSGRVKLMHNHAPVTKL EEECCCCCCCCCCCCCHHHHHCCCHHHHHHHHCCCCCCEEEEECCCCCCCC >Mature Secondary Structure SVHATDAKPPGPSPADQLLDGLNPQQRQAVVHEGSPLLIVAGAGSGKTAVLTRRIAYLM CCCCCCCCCCCCCCHHHHHHCCCHHHHHHHHCCCCCEEEEEECCCCCHHHHHHHHHHHH AARGVGVGQILAITFTNKAAAEMRERVVGLVGEKARYMWVSTFHSTCVRILRNQAALIEG HHCCCCCCEEEEEEECCHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHC LNSNFSIYDADDSRRLLQMVGRDLGLDIKRYSPRLLANAISNLKNELIDPHQALAGLTED CCCCCEEEECCHHHHHHHHHCHHHCCCHHHCCHHHHHHHHHHHHHHHCCHHHHHHCCCCC SDDLARAVASVYDEYQRRLRAANALDFDDLIGETVAVLQAFPQIAQYYRRRFRHVLVDEY HHHHHHHHHHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH QDTNHAQYVLVRELVGRDSNDGIPPGELCVVGDADQSIYAFRGATIRNIEDFERDYPDTR CCCCCHHHHHHHHHHCCCCCCCCCCCCEEEEECCCCCEEEECCCCCCCHHHHHHCCCCCE TILLEQNYRSTQNILSAANSVIARNAGRREKRLWTDAGAGELIVGYVADNEHDEARFVAE EEEEECCCHHHHHHHHHHHHHHHHCCCCHHHHHCCCCCCCCEEEEEECCCCCHHHHHHHH EIDALAEGSEITYNDVAVFYRTNNSSRSLEEVLIRAGIPYKVVGGVRFYERKEIRDIVAY HHHHHHCCCCEEECCEEEEEEECCCCHHHHHHHHHCCCCEEEECCCHHHHHHHHHHHHHH LRVLDNPGDAVSLRRILNTPRRGIGDRAEACVAVYAENTGVGFGDALVAAAQGKVPMLNT HHHHCCCCCHHHHHHHHCCCCCCCCCHHHHEEEEEECCCCCCCCHHHHHHCCCCCCCCCC RAEKAIAGFVEMFDELRGRLDDDLGELVEAVLERTGYRRELEASTDPQELARLDNLNELV HHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHCCCCEECCCCCCHHHHHHHHCHHHHH SVAHEFSTDRENAAALGPDDEDVPDTGVLADFLERVSLVADADEIPEHGAGVVTLMTLHT HHHHHHCCCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHHCHHHCCCCCCCEEEEEEEHH AKGLEFPVVFVTGWEDGMFPHMRALDNPTELSEERRLAYVGITRARQRLYVSRAIVRSSW CCCCCCCEEEEECCCCCCCHHHHHCCCCHHHHHHHCEEEEEHHHHHHHHHHHHHHHHHCC GQPMLNPESRFLREIPQELIDWRRTAPKPSFSAPVSGAGRFGSARPSPTRSGASRRPLLV CCCCCCHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCCEEE LQVGDRVTHDKYGLGRVEEVSGVGESAMSLIDFGSSGRVKLMHNHAPVTKL EEECCCCCCCCCCCCCHHHHHCCCHHHHHHHHCCCCCCEEEEECCCCCCCC
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: 12788972