| Definition | Mycobacterium bovis BCG str. Pasteur 1173P2, complete genome. |
|---|---|
| Accession | NC_008769 |
| Length | 4,374,522 |
Click here to switch to the map view.
The map label for this gene is yejH [C]
Identifier: 121636784
GI number: 121636784
Start: 989028
End: 990656
Strand: Reverse
Name: yejH [C]
Synonym: BCG_0913c
Alternate gene names: 121636784
Gene position: 990656-989028 (Counterclockwise)
Preceding gene: 121636785
Following gene: 121636781
Centisome position: 22.65
GC content: 64.52
Gene sequence:
>1629_bases GTGCAGTCCGATAAGACGGTGCTGTTGGAAGTCGACCATGAACTGGCCGGCGCTGCACGCGCCGCCATCGCGCCGTTCGC CGAGCTGGAACGTGCACCCGAACATGTCCACACCTACCGCATCACACCGCTGGCACTGTGGAATGCTCGCGCCGCCGGCC ATGATGCCGAGCAAGTCGTCGACGCGCTGGTCAGTTACTCCCGCTACGCGGTGCCGCAACCCTTGCTCGTCGACATCGTC GACACCATGGCCCGCTACGGACGACTGCAGTTGGTCAAGAACCCGGCCCATGGCCTGACGCTGGTGAGCCTGGACCGCGC GGTGCTTGAGGAAGTGCTGCGCAACAAGAAGATCGCGCCGATGCTTGGCGCCCGCATCGATGACGACACCGTCGTCGTCC ACCCCAGCGAACGCGGCCGGGTCAAGCAGCTGCTGCTCAAGATCGGTTGGCCCGCAGAGGATCTCGCCGGCTACGTCGAT GGTGAAGCGCACCCGATCAGCCTGCACCAGGAGGGCTGGCAGCTGCGCGATTACCAGCGGCTGGCCGCGGACTCGTTCTG GGCGGGCGGCTCCGGGGTGGTGGTGCTGCCATGTGGGGCCGGCAAGACGCTGGTCGGTGCGGCCGCAATGGCCAAAGCCG GCGCGACGACGTTGATCCTGGTCACCAATATCGTCGCGGCCCGGCAATGGAAACGAGAGCTGGTCGCGCGCACCTCGCTC ACCGAGAATGAGATCGGCGAATTCTCGGGAGAACGCAAGGAAATCCGACCTGCCACCATCTCGACATACCAGATGATCAC CCGCCGCACTAAGGGCGAGTACCGCCATCTGGAACTGTTCGACAGCCGCGACTGGGGGCTCATCATCTATGACGAGGTGC ACCTGTTGCCGGCACCGGTCTTCCGGATGACCGCTGACCTGCAGTCCAAACGGCGGCTGGGGCTGACCGCCACGTTGATC CGTGAAGACGGACGCGAGGGCGACGTGTTTTCCCTTATCGGACCAAAGCGCTATGACGCGCCGTGGAAGGACATTGAGGC GCAGGGCTGGATCGCGCCAGCTGAGTGCGTGGAAGTCCGGGTCACGATGACCGACAGCGAGCGGATGATGTACGCCACCG CCGAACCCGAAGAACGCTACCGGATCTGCTCGACGGTGCACACCAAAATTGCTGTGGTCAAGTCGATTCTGGCGAAGCAC CCGGATGAGCAGACCCTGGTCATCGGAGCGTACTTGGATCAGCTCGACGAGCTGGGCGCCGAGCTCGGCGCTCCGGTGAT TCAGGGGTCGACAAGGACCAGCGAACGCGAGGCACTGTTCGACGCCTTCCGCCGCGGCGAGGTCGCTACGCTCGTGGTGT CCAAGGTGGCTAACTTCTCCATCGACTTGCCGGAAGCCGCCGTGGCGGTACAGGTTTCGGGAACATTCGGCTCACGCCAG GAAGAGGCGCAACGGCTCGGCCGGATATTGCGACCCAAGGCCGACGGGGGCGGTGCCATCTTCTACTCGGTGGTGGCCCG CGACAGCCTGGATGCCGAGTACGCCGCACACCGGCAGCGGTTTTTAGCTGAGCAGGGCTACGGTTACATCATCCGCGACG CCGACGACCTGCTGGGCCCGGCAATTTAG
Upstream 100 bases:
>100_bases CGCAGCGATGAGGAGGAGCGGCGCCATTGACTACCGCCGGCGACGATGCAGAGCGCAGCGATGAGGAGGAGCGGCGCCAT TGACTGACGGACCATTGATA
Downstream 100 bases:
>100_bases GTTGCGCGAGCAGACGTAAAAGCCCCCGACACGCCGAGCGTGCGGGGGCTTTTACGTCTGCTCGCGCTCAGCTTAGCAGC GACTCCGGCGGCAGGAAGCG
Product: putative DNA helicase
Products: NA
Alternate protein names: DNA Repair Helicase; Type III Restriction Res Subunit; Helicase Domain Protein; Helicase Domain-Containing Protein; ATP-Dependent DNA Helicase; DNA Repair Helicase RAD; DNA Repair Helicase Rad; Type III Restriction Res Subunit Family; Superfamily II DNA/RNA Helicase; DNA/RNA Helicase; DNA Repair Protein Rad; Helicase; DNA Repair Protein RAD; DNA Helicase; DNA Repair Protein; DNA/RNA Helicase Superfamily II; Helicase-Like Protein; Helicase Protein; ATP-Dependent Helicase; DNA Or RNA Helicase Of Superfamily II; Helicase ATP-Dependent; Helicase DNA Repair; DNA Or RNA Helicase; Helicase DNA Repair Rad; RAD25-Type DNA Repair Helicase; DNA Repair Related Protein; Restriction Endonuclease Family Protein; XPB/RAD25-Related Helicase; Helicase ATP-Dependent Intein-Containing; DEAD/DEAH Box Helicase-Like; DNA-Helicase; DNA/RNA Repair Helicase; DNA Or RNA Helicase Of Superfamily Protein II; DEAD/DEAH Box Helicase
Number of amino acids: Translated: 542; Mature: 542
Protein sequence:
>542_residues MQSDKTVLLEVDHELAGAARAAIAPFAELERAPEHVHTYRITPLALWNARAAGHDAEQVVDALVSYSRYAVPQPLLVDIV DTMARYGRLQLVKNPAHGLTLVSLDRAVLEEVLRNKKIAPMLGARIDDDTVVVHPSERGRVKQLLLKIGWPAEDLAGYVD GEAHPISLHQEGWQLRDYQRLAADSFWAGGSGVVVLPCGAGKTLVGAAAMAKAGATTLILVTNIVAARQWKRELVARTSL TENEIGEFSGERKEIRPATISTYQMITRRTKGEYRHLELFDSRDWGLIIYDEVHLLPAPVFRMTADLQSKRRLGLTATLI REDGREGDVFSLIGPKRYDAPWKDIEAQGWIAPAECVEVRVTMTDSERMMYATAEPEERYRICSTVHTKIAVVKSILAKH PDEQTLVIGAYLDQLDELGAELGAPVIQGSTRTSEREALFDAFRRGEVATLVVSKVANFSIDLPEAAVAVQVSGTFGSRQ EEAQRLGRILRPKADGGGAIFYSVVARDSLDAEYAAHRQRFLAEQGYGYIIRDADDLLGPAI
Sequences:
>Translated_542_residues MQSDKTVLLEVDHELAGAARAAIAPFAELERAPEHVHTYRITPLALWNARAAGHDAEQVVDALVSYSRYAVPQPLLVDIV DTMARYGRLQLVKNPAHGLTLVSLDRAVLEEVLRNKKIAPMLGARIDDDTVVVHPSERGRVKQLLLKIGWPAEDLAGYVD GEAHPISLHQEGWQLRDYQRLAADSFWAGGSGVVVLPCGAGKTLVGAAAMAKAGATTLILVTNIVAARQWKRELVARTSL TENEIGEFSGERKEIRPATISTYQMITRRTKGEYRHLELFDSRDWGLIIYDEVHLLPAPVFRMTADLQSKRRLGLTATLI REDGREGDVFSLIGPKRYDAPWKDIEAQGWIAPAECVEVRVTMTDSERMMYATAEPEERYRICSTVHTKIAVVKSILAKH PDEQTLVIGAYLDQLDELGAELGAPVIQGSTRTSEREALFDAFRRGEVATLVVSKVANFSIDLPEAAVAVQVSGTFGSRQ EEAQRLGRILRPKADGGGAIFYSVVARDSLDAEYAAHRQRFLAEQGYGYIIRDADDLLGPAI >Mature_542_residues MQSDKTVLLEVDHELAGAARAAIAPFAELERAPEHVHTYRITPLALWNARAAGHDAEQVVDALVSYSRYAVPQPLLVDIV DTMARYGRLQLVKNPAHGLTLVSLDRAVLEEVLRNKKIAPMLGARIDDDTVVVHPSERGRVKQLLLKIGWPAEDLAGYVD GEAHPISLHQEGWQLRDYQRLAADSFWAGGSGVVVLPCGAGKTLVGAAAMAKAGATTLILVTNIVAARQWKRELVARTSL TENEIGEFSGERKEIRPATISTYQMITRRTKGEYRHLELFDSRDWGLIIYDEVHLLPAPVFRMTADLQSKRRLGLTATLI REDGREGDVFSLIGPKRYDAPWKDIEAQGWIAPAECVEVRVTMTDSERMMYATAEPEERYRICSTVHTKIAVVKSILAKH PDEQTLVIGAYLDQLDELGAELGAPVIQGSTRTSEREALFDAFRRGEVATLVVSKVANFSIDLPEAAVAVQVSGTFGSRQ EEAQRLGRILRPKADGGGAIFYSVVARDSLDAEYAAHRQRFLAEQGYGYIIRDADDLLGPAI
Specific function: Unknown
COG id: COG1061
COG function: function code KL; DNA or RNA helicases of superfamily II
Gene ontology:
Cell location: Cytoplasm [C]
Metaboloic importance: Unknown [C]
Operon status: Not Known
Operon components: None
Similarity: NA
Homologues:
Organism=Homo sapiens, GI4557563, Length=375, Percent_Identity=36, Blast_Score=235, Evalue=9e-62, Organism=Caenorhabditis elegans, GI17556358, Length=379, Percent_Identity=35.6200527704486, Blast_Score=234, Evalue=1e-61, Organism=Saccharomyces cerevisiae, GI6322048, Length=602, Percent_Identity=29.734219269103, Blast_Score=260, Evalue=4e-70, Organism=Drosophila melanogaster, GI221331068, Length=375, Percent_Identity=36, Blast_Score=234, Evalue=1e-61, Organism=Drosophila melanogaster, GI24662247, Length=375, Percent_Identity=36, Blast_Score=234, Evalue=1e-61,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): NA
Other databases:
NA
Pfam domain/function: NA
EC number: NA
Molecular weight: Translated: 59777; Mature: 59777
Theoretical pI: Translated: 5.95; Mature: 5.95
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
None
Cys/Met content:
0.6 %Cys (Translated Protein) 1.7 %Met (Translated Protein) 2.2 %Cys+Met (Translated Protein) 0.6 %Cys (Mature Protein) 1.7 %Met (Mature Protein) 2.2 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MQSDKTVLLEVDHELAGAARAAIAPFAELERAPEHVHTYRITPLALWNARAAGHDAEQVV CCCCCEEEEEECCHHHHHHHHHHCCHHHHHCCHHHHHEEEECEEEEECCCCCCCCHHHHH DALVSYSRYAVPQPLLVDIVDTMARYGRLQLVKNPAHGLTLVSLDRAVLEEVLRNKKIAP HHHHHHHHHCCCCHHHHHHHHHHHHCCEEEEEECCCCCEEEEHHHHHHHHHHHHCCCCCH MLGARIDDDTVVVHPSERGRVKQLLLKIGWPAEDLAGYVDGEAHPISLHQEGWQLRDYQR HHCCCCCCCEEEECCCCCCHHHHHHHHCCCCHHHHHHHCCCCCCEEEECCCCCCHHHHHH LAADSFWAGGSGVVVLPCGAGKTLVGAAAMAKAGATTLILVTNIVAARQWKRELVARTSL HHHHCCCCCCCCEEEEECCCCCHHHHHHHHHHCCCEEEEHHHHHHHHHHHHHHHHHHHCC TENEIGEFSGERKEIRPATISTYQMITRRTKGEYRHLELFDSRDWGLIIYDEVHLLPAPV CHHHHHHCCCCCCCCCCCHHHHHHHHHHHCCCCEEEEEEECCCCCCEEEEECCCCCCCCH FRMTADLQSKRRLGLTATLIREDGREGDVFSLIGPKRYDAPWKDIEAQGWIAPAECVEVR HHHHHHHHHHHCCCCEEEEECCCCCCCCEEEECCCCCCCCCCCCCCCCCCCCCCCEEEEE VTMTDSERMMYATAEPEERYRICSTVHTKIAVVKSILAKHPDEQTLVIGAYLDQLDELGA EEEECCCEEEEEECCHHHHHHHHHHHHHHHHHHHHHHHHCCCCCEEEEHHHHHHHHHHHH ELGAPVIQGSTRTSEREALFDAFRRGEVATLVVSKVANFSIDLPEAAVAVQVSGTFGSRQ HHCCCEECCCCCCHHHHHHHHHHHCCCHHHHHHHHHHCCCCCCCCCEEEEEEECCCCCCH EEAQRLGRILRPKADGGGAIFYSVVARDSLDAEYAAHRQRFLAEQGYGYIIRDADDLLGP HHHHHHHHHHCCCCCCCCEEEEEEHHCCCCCHHHHHHHHHHHHHCCCCEEEECCHHHCCC AI CC >Mature Secondary Structure MQSDKTVLLEVDHELAGAARAAIAPFAELERAPEHVHTYRITPLALWNARAAGHDAEQVV CCCCCEEEEEECCHHHHHHHHHHCCHHHHHCCHHHHHEEEECEEEEECCCCCCCCHHHHH DALVSYSRYAVPQPLLVDIVDTMARYGRLQLVKNPAHGLTLVSLDRAVLEEVLRNKKIAP HHHHHHHHHCCCCHHHHHHHHHHHHCCEEEEEECCCCCEEEEHHHHHHHHHHHHCCCCCH MLGARIDDDTVVVHPSERGRVKQLLLKIGWPAEDLAGYVDGEAHPISLHQEGWQLRDYQR HHCCCCCCCEEEECCCCCCHHHHHHHHCCCCHHHHHHHCCCCCCEEEECCCCCCHHHHHH LAADSFWAGGSGVVVLPCGAGKTLVGAAAMAKAGATTLILVTNIVAARQWKRELVARTSL HHHHCCCCCCCCEEEEECCCCCHHHHHHHHHHCCCEEEEHHHHHHHHHHHHHHHHHHHCC TENEIGEFSGERKEIRPATISTYQMITRRTKGEYRHLELFDSRDWGLIIYDEVHLLPAPV CHHHHHHCCCCCCCCCCCHHHHHHHHHHHCCCCEEEEEEECCCCCCEEEEECCCCCCCCH FRMTADLQSKRRLGLTATLIREDGREGDVFSLIGPKRYDAPWKDIEAQGWIAPAECVEVR HHHHHHHHHHHCCCCEEEEECCCCCCCCEEEECCCCCCCCCCCCCCCCCCCCCCCEEEEE VTMTDSERMMYATAEPEERYRICSTVHTKIAVVKSILAKHPDEQTLVIGAYLDQLDELGA EEEECCCEEEEEECCHHHHHHHHHHHHHHHHHHHHHHHHCCCCCEEEEHHHHHHHHHHHH ELGAPVIQGSTRTSEREALFDAFRRGEVATLVVSKVANFSIDLPEAAVAVQVSGTFGSRQ HHCCCEECCCCCCHHHHHHHHHHHCCCHHHHHHHHHHCCCCCCCCCEEEEEEECCCCCCH EEAQRLGRILRPKADGGGAIFYSVVARDSLDAEYAAHRQRFLAEQGYGYIIRDADDLLGP HHHHHHHHHHCCCCCCCCEEEEEEHHCCCCCHHHHHHHHHHHHHCCCCEEEECCHHHCCC AI CC
PDB accession: NA
Resolution: NA
Structure class: Alpha Beta
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: NA
Specific reaction: NA
General reaction: NA
Inhibitor: NA
Structure determination priority: 9.0
TargetDB status: NA
Availability: NA
References: NA