Definition Mycobacterium bovis BCG str. Pasteur 1173P2, complete genome.
Accession NC_008769
Length 4,374,522

Click here to switch to the map view.

The map label for this gene is fimZ [C]

Identifier: 121636813

GI number: 121636813

Start: 1020405

End: 1023053

Strand: Reverse

Name: fimZ [C]

Synonym: BCG_0942c

Alternate gene names: 121636813

Gene position: 1023053-1020405 (Counterclockwise)

Preceding gene: 121636814

Following gene: 121636812

Centisome position: 23.39

GC content: 64.74

Gene sequence:

>2649_bases
GTGCGGGCACTGTTGGCGCAGAACCGGCTCGTGACGCTATGCGGAACCGGCGGTGTCGGCAAGACCCGTCTGGCAATCCA
GATCGCGAGTGCATCCGAACTTCGCGACGGTTTGTGCTTTGTCGATCTGGCCCCGATCACTGAATCCGGGATCGTCGCAG
CCACGGCTGCGCGCGCCGTGGGTCTGCCCGATCAGCCGGGCCGTTCAACCATGGATAGTCTTCGCCGATTCATCGGCAAT
CGCCGCATGCTCATGGTGTTGGACAACTGTGAACATCTTCTCGATGCGTGCGCAGCGTTGGTCGTTGAGCTATTGGGGGC
CTGTCCGGAGCTGACGATCTTAGCGACTAGCCGGGAGCCGATCGGGATGGCCGGCGAGATCACCTGGCGCGTACCGTCGA
TGTCGATAACCGACGAAGCAGTCGAATTGTTTGCTGACCGAGCCAGCCGAGTTCAGCCCGGGTTCACCATCGCCAATCAC
AACGCCGCGGCCGTCGGCGAGATCTGCCGGCGGCTAGACGGCATACCGCTGGCGATCGAGTTCGCTGCCGCACGGGTGCG
GTCGATGTCACCGCTCGAGATTGCCGACGGTCTGGACGACTGTTTCCGGCTGTTGGCCGGCGGTGTGCGGGGCGCGGTGC
AGCGCCAGCAGACACTTCGCGCCTCGATCGATTGGTCGCATGCACTGCTGACCGAGACCGAGCAAATCTTGTTTCGGCGA
CTGGCGCCATTTGTCGGCGGGTTCGACCTCGCCGCGGTGCGGGCGGTCGCCGCCGGTAGCGACCTGGATCCGTTTTCGGT
GCTTGATCAGCTGACCCTGCTGGTAGACAAGTCGCTGGTGGTGGCCGACGACTGCCAGGGCCGCACGCGGTACCGGCTGC
TGGAAACGGTGCGTCGGTACGCGCTGGAAAAACTGGGCGACTCCGGCGAGGCCGATGTGCACGCACGTCACCGTGACTAC
TACACGGCGCTGGCCGCCTCACTCAACACTCCTGCGGACAACGATCACCAACGGCTTGTCGCCCGGGCTGAGACCGAGAT
CGACAACCTGCGCGCCGCGTTCGCCTGGAGCCGGGAAAATGGCCATATCACCGAAGCGTTACAGCTCGCATCTTCGCTGC
AACCAATCTGGTTCGGGCGGGCGCACCTGCGCGAGGGGTTGTCCTGGTTCAACTCGATCCTGGAAGACCAAAGGTTCCAC
CGGCTCGCTGTGTCAACAGCAGTACGGGCGCGAGCGCTCGCTGACAAGGCAATGCTCAGTACCTGGCTGGCCACCAGTCC
GGTAGGCGCCACCGACATCATCGCTCCCGCACAACAAGCGCTGGCGATGGCACGTGAGGTGGGCGACCCCGCCGCGTTGG
TGCGGGCGCTCACCGCCTGCGGCTGTAGCAGTGGCTACAACGCGGAGGCCGCTGCGCCCTATTTCGCCGAAGCGACCGAC
CTGGCACGCGCTATTGACGACAAATGGACGCTGTGTCAAATCCTCTACTGGCGGGGGGTGGGGACCTGCATATCAGGTGA
CCCGAATGCTTTGCGAGCCGCGGCAGAAGAATGCCGCGACCTGGCCGACACCATCGGCGACCGGTTCGTCTCACGTCACT
GCAGCTTGTGGCTTAGTTTGGCGCAGATGTGGGCTGGCAATCTGACCGAAGCCCTCGAGCTATCCAGGGAAATCACTGCC
GAGGCCGAGGCATCCAACGATGTGCCGACAAAGGTTCTCGGCCTATATACCCAAGCCCAGGTGCTGGCGTATTGCGGCGC
CAGCGCGGCCCACGCCATAGCCGGGGCGTGCATTGCAGCCGCGACGGAGTTAGGCGGTGTGTACCAAGGCATTGGTTATG
CGGCGATGACGTACGCCGCGCTGGCCGCCGGTGATGTCACGGCAGCGCTCGAGGCCAGCGACGCGGCGCGGCCGATTCTT
AGGGCCCAGCCCGACCAGGTGACCATGCACCAGGTCCTGATGGCGCAGTTAGCCCTGGCAGGAGGTGATGCGATCGCCGC
ACGACAGTTCGCCAACGACGCCGTCGATGCGACCAATGGGTGGCACCGAATGGTGGCGTTGACAATACGCGCGCGCGTAG
CCACCGCACGGGGCGAACCAGAACTGGCGCGCGATGATGCTCATGCTGCGCTGGCGTGCGGCGCCGAGCTGCACATCTAC
CAGGGCATGCCAGATGCCATGGAACTCCTCGCCGGCCTGGCCGGCGAGGTCGGCAGTCACTCCGAAGGTGTCCGCCTTCT
CGGTGCCGCAGCCGCCCTTCGGCAACAGACACGTCAGGTCCGCTTCAAGATTTGGGATGCCGGCTACCAGGCCTCGGTGA
CGGCGCTTCGTGAGGCGATGGGTGATGAGGATTTCGACCGCGCCTGGGCCGAGGGGGCCGCCTTGTCCACCGACGAGGCG
ATCGCATATGCACAACGCGGTCGCGGTGAACGCAAGCGACCGGCCCGCGGGTGGGGCTCGTTGACCCCGACCGAACGCGA
CGTCGTGCGGTTGGTCAGCGAGGGGTTATCCAACAAGGACATTGCAAAACGGCTTTTCGTCTCGCCGCGCACTGTGCAAA
CCCACCTCACCCACGTCTACGCCAAACTTGGCTTGGCCTCCCGAGTACAACTGGTAGACGAGGCGGCACGCCGCGGCTCA
CCCTCGTGA

Upstream 100 bases:

>100_bases
GAAAAGTTTCCCCCACTGCGCACGGCCAAATCCAGCCCGACATCGATTCTCCCGGCGCAGTTCACCACATTTGTGGGCCG
CCGTGCGCAAATAAGCTGAG

Downstream 100 bases:

>100_bases
CGATTCTCGCGGCACGCTCATCGCCGGCACCGTGATTGGCACCAGCCGGTAGCGTCGTTGCCGGGGCCAGGTGTGAGAAT
TCTCGTATGACAGTGGTCCC

Product: LuxR family transcriptional regulator

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 882; Mature: 882

Protein sequence:

>882_residues
MRALLAQNRLVTLCGTGGVGKTRLAIQIASASELRDGLCFVDLAPITESGIVAATAARAVGLPDQPGRSTMDSLRRFIGN
RRMLMVLDNCEHLLDACAALVVELLGACPELTILATSREPIGMAGEITWRVPSMSITDEAVELFADRASRVQPGFTIANH
NAAAVGEICRRLDGIPLAIEFAAARVRSMSPLEIADGLDDCFRLLAGGVRGAVQRQQTLRASIDWSHALLTETEQILFRR
LAPFVGGFDLAAVRAVAAGSDLDPFSVLDQLTLLVDKSLVVADDCQGRTRYRLLETVRRYALEKLGDSGEADVHARHRDY
YTALAASLNTPADNDHQRLVARAETEIDNLRAAFAWSRENGHITEALQLASSLQPIWFGRAHLREGLSWFNSILEDQRFH
RLAVSTAVRARALADKAMLSTWLATSPVGATDIIAPAQQALAMAREVGDPAALVRALTACGCSSGYNAEAAAPYFAEATD
LARAIDDKWTLCQILYWRGVGTCISGDPNALRAAAEECRDLADTIGDRFVSRHCSLWLSLAQMWAGNLTEALELSREITA
EAEASNDVPTKVLGLYTQAQVLAYCGASAAHAIAGACIAAATELGGVYQGIGYAAMTYAALAAGDVTAALEASDAARPIL
RAQPDQVTMHQVLMAQLALAGGDAIAARQFANDAVDATNGWHRMVALTIRARVATARGEPELARDDAHAALACGAELHIY
QGMPDAMELLAGLAGEVGSHSEGVRLLGAAAALRQQTRQVRFKIWDAGYQASVTALREAMGDEDFDRAWAEGAALSTDEA
IAYAQRGRGERKRPARGWGSLTPTERDVVRLVSEGLSNKDIAKRLFVSPRTVQTHLTHVYAKLGLASRVQLVDEAARRGS
PS

Sequences:

>Translated_882_residues
MRALLAQNRLVTLCGTGGVGKTRLAIQIASASELRDGLCFVDLAPITESGIVAATAARAVGLPDQPGRSTMDSLRRFIGN
RRMLMVLDNCEHLLDACAALVVELLGACPELTILATSREPIGMAGEITWRVPSMSITDEAVELFADRASRVQPGFTIANH
NAAAVGEICRRLDGIPLAIEFAAARVRSMSPLEIADGLDDCFRLLAGGVRGAVQRQQTLRASIDWSHALLTETEQILFRR
LAPFVGGFDLAAVRAVAAGSDLDPFSVLDQLTLLVDKSLVVADDCQGRTRYRLLETVRRYALEKLGDSGEADVHARHRDY
YTALAASLNTPADNDHQRLVARAETEIDNLRAAFAWSRENGHITEALQLASSLQPIWFGRAHLREGLSWFNSILEDQRFH
RLAVSTAVRARALADKAMLSTWLATSPVGATDIIAPAQQALAMAREVGDPAALVRALTACGCSSGYNAEAAAPYFAEATD
LARAIDDKWTLCQILYWRGVGTCISGDPNALRAAAEECRDLADTIGDRFVSRHCSLWLSLAQMWAGNLTEALELSREITA
EAEASNDVPTKVLGLYTQAQVLAYCGASAAHAIAGACIAAATELGGVYQGIGYAAMTYAALAAGDVTAALEASDAARPIL
RAQPDQVTMHQVLMAQLALAGGDAIAARQFANDAVDATNGWHRMVALTIRARVATARGEPELARDDAHAALACGAELHIY
QGMPDAMELLAGLAGEVGSHSEGVRLLGAAAALRQQTRQVRFKIWDAGYQASVTALREAMGDEDFDRAWAEGAALSTDEA
IAYAQRGRGERKRPARGWGSLTPTERDVVRLVSEGLSNKDIAKRLFVSPRTVQTHLTHVYAKLGLASRVQLVDEAARRGS
PS
>Mature_882_residues
MRALLAQNRLVTLCGTGGVGKTRLAIQIASASELRDGLCFVDLAPITESGIVAATAARAVGLPDQPGRSTMDSLRRFIGN
RRMLMVLDNCEHLLDACAALVVELLGACPELTILATSREPIGMAGEITWRVPSMSITDEAVELFADRASRVQPGFTIANH
NAAAVGEICRRLDGIPLAIEFAAARVRSMSPLEIADGLDDCFRLLAGGVRGAVQRQQTLRASIDWSHALLTETEQILFRR
LAPFVGGFDLAAVRAVAAGSDLDPFSVLDQLTLLVDKSLVVADDCQGRTRYRLLETVRRYALEKLGDSGEADVHARHRDY
YTALAASLNTPADNDHQRLVARAETEIDNLRAAFAWSRENGHITEALQLASSLQPIWFGRAHLREGLSWFNSILEDQRFH
RLAVSTAVRARALADKAMLSTWLATSPVGATDIIAPAQQALAMAREVGDPAALVRALTACGCSSGYNAEAAAPYFAEATD
LARAIDDKWTLCQILYWRGVGTCISGDPNALRAAAEECRDLADTIGDRFVSRHCSLWLSLAQMWAGNLTEALELSREITA
EAEASNDVPTKVLGLYTQAQVLAYCGASAAHAIAGACIAAATELGGVYQGIGYAAMTYAALAAGDVTAALEASDAARPIL
RAQPDQVTMHQVLMAQLALAGGDAIAARQFANDAVDATNGWHRMVALTIRARVATARGEPELARDDAHAALACGAELHIY
QGMPDAMELLAGLAGEVGSHSEGVRLLGAAAALRQQTRQVRFKIWDAGYQASVTALREAMGDEDFDRAWAEGAALSTDEA
IAYAQRGRGERKRPARGWGSLTPTERDVVRLVSEGLSNKDIAKRLFVSPRTVQTHLTHVYAKLGLASRVQLVDEAARRGS
PS

Specific function: Unknown

COG id: COG3903

COG function: function code R; Predicted ATPase

Gene ontology:

Cell location: Cytoplasmic

Metaboloic importance: Non_Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 HTH luxR-type DNA-binding domain [H]

Homologues:

None

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR000767
- InterPro:   IPR016032
- InterPro:   IPR011990
- InterPro:   IPR000792
- InterPro:   IPR011991 [H]

Pfam domain/function: PF00196 GerE [H]

EC number: NA

Molecular weight: Translated: 94471; Mature: 94471

Theoretical pI: Translated: 5.86; Mature: 5.86

Prosite motif: PS00622 HTH_LUXR_1 ; PS50043 HTH_LUXR_2

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

1.9 %Cys     (Translated Protein)
1.9 %Met     (Translated Protein)
3.9 %Cys+Met (Translated Protein)
1.9 %Cys     (Mature Protein)
1.9 %Met     (Mature Protein)
3.9 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MRALLAQNRLVTLCGTGGVGKTRLAIQIASASELRDGLCFVDLAPITESGIVAATAARAV
CCCCHHCCCEEEEECCCCCCCEEEEEEECCHHHHHCCEEEEEECCCCCCCCHHHHHHHHC
GLPDQPGRSTMDSLRRFIGNRRMLMVLDNCEHLLDACAALVVELLGACPELTILATSREP
CCCCCCCHHHHHHHHHHHCCCEEEEEEHHHHHHHHHHHHHHHHHHCCCCCEEEEEECCCC
IGMAGEITWRVPSMSITDEAVELFADRASRVQPGFTIANHNAAAVGEICRRLDGIPLAIE
CCCCCEEEEECCCCCHHHHHHHHHHHHHHHCCCCCEEECCCHHHHHHHHHHHCCCCEEHH
FAAARVRSMSPLEIADGLDDCFRLLAGGVRGAVQRQQTLRASIDWSHALLTETEQILFRR
HHHHHHCCCCCHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHH
LAPFVGGFDLAAVRAVAAGSDLDPFSVLDQLTLLVDKSLVVADDCQGRTRYRLLETVRRY
HHHHHCCHHHHHHHHHHCCCCCCHHHHHHHHHHHHCCCEEEECCCCCCHHHHHHHHHHHH
ALEKLGDSGEADVHARHRDYYTALAASLNTPADNDHQRLVARAETEIDNLRAAFAWSREN
HHHHCCCCCCCCHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHEEECCC
GHITEALQLASSLQPIWFGRAHLREGLSWFNSILEDQRFHRLAVSTAVRARALADKAMLS
CCHHHHHHHHHCCCCHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
TWLATSPVGATDIIAPAQQALAMAREVGDPAALVRALTACGCSSGYNAEAAAPYFAEATD
HHHHCCCCCCHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHCCCCCCCCCCCCCHHHHHHH
LARAIDDKWTLCQILYWRGVGTCISGDPNALRAAAEECRDLADTIGDRFVSRHCSLWLSL
HHHHHCCCHHHHHHHHHHCCCCEECCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
AQMWAGNLTEALELSREITAEAEASNDVPTKVLGLYTQAQVLAYCGASAAHAIAGACIAA
HHHHCCCHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHH
ATELGGVYQGIGYAAMTYAALAAGDVTAALEASDAARPILRAQPDQVTMHQVLMAQLALA
HHHHHHHHHHHHHHHHHHHHHHHCCHHHHHCCCHHHCHHHHCCCCHHHHHHHHHHHHHHC
GGDAIAARQFANDAVDATNGWHRMVALTIRARVATARGEPELARDDAHAALACGAELHIY
CCCHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHCCCCCCHHHCCCHHHHHCCCEEEEE
QGMPDAMELLAGLAGEVGSHSEGVRLLGAAAALRQQTRQVRFKIWDAGYQASVTALREAM
CCCCHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHHEEECCCCHHHHHHHHHHH
GDEDFDRAWAEGAALSTDEAIAYAQRGRGERKRPARGWGSLTPTERDVVRLVSEGLSNKD
CCCHHHHHHHCCCCCCCHHHHHHHHHCCCCCCCCCCCCCCCCCCHHHHHHHHHCCCCCHH
IAKRLFVSPRTVQTHLTHVYAKLGLASRVQLVDEAARRGSPS
HHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCC
>Mature Secondary Structure
MRALLAQNRLVTLCGTGGVGKTRLAIQIASASELRDGLCFVDLAPITESGIVAATAARAV
CCCCHHCCCEEEEECCCCCCCEEEEEEECCHHHHHCCEEEEEECCCCCCCCHHHHHHHHC
GLPDQPGRSTMDSLRRFIGNRRMLMVLDNCEHLLDACAALVVELLGACPELTILATSREP
CCCCCCCHHHHHHHHHHHCCCEEEEEEHHHHHHHHHHHHHHHHHHCCCCCEEEEEECCCC
IGMAGEITWRVPSMSITDEAVELFADRASRVQPGFTIANHNAAAVGEICRRLDGIPLAIE
CCCCCEEEEECCCCCHHHHHHHHHHHHHHHCCCCCEEECCCHHHHHHHHHHHCCCCEEHH
FAAARVRSMSPLEIADGLDDCFRLLAGGVRGAVQRQQTLRASIDWSHALLTETEQILFRR
HHHHHHCCCCCHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHHH
LAPFVGGFDLAAVRAVAAGSDLDPFSVLDQLTLLVDKSLVVADDCQGRTRYRLLETVRRY
HHHHHCCHHHHHHHHHHCCCCCCHHHHHHHHHHHHCCCEEEECCCCCCHHHHHHHHHHHH
ALEKLGDSGEADVHARHRDYYTALAASLNTPADNDHQRLVARAETEIDNLRAAFAWSREN
HHHHCCCCCCCCHHHHHHHHHHHHHHHCCCCCCCHHHHHHHHHHHHHHHHHHHHEEECCC
GHITEALQLASSLQPIWFGRAHLREGLSWFNSILEDQRFHRLAVSTAVRARALADKAMLS
CCHHHHHHHHHCCCCHHCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
TWLATSPVGATDIIAPAQQALAMAREVGDPAALVRALTACGCSSGYNAEAAAPYFAEATD
HHHHCCCCCCHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHCCCCCCCCCCCCCHHHHHHH
LARAIDDKWTLCQILYWRGVGTCISGDPNALRAAAEECRDLADTIGDRFVSRHCSLWLSL
HHHHHCCCHHHHHHHHHHCCCCEECCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
AQMWAGNLTEALELSREITAEAEASNDVPTKVLGLYTQAQVLAYCGASAAHAIAGACIAA
HHHHCCCHHHHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHH
ATELGGVYQGIGYAAMTYAALAAGDVTAALEASDAARPILRAQPDQVTMHQVLMAQLALA
HHHHHHHHHHHHHHHHHHHHHHHCCHHHHHCCCHHHCHHHHCCCCHHHHHHHHHHHHHHC
GGDAIAARQFANDAVDATNGWHRMVALTIRARVATARGEPELARDDAHAALACGAELHIY
CCCHHHHHHHHHHHCCCCCCHHHHHHHHHHHHHHHCCCCCCHHHCCCHHHHHCCCEEEEE
QGMPDAMELLAGLAGEVGSHSEGVRLLGAAAALRQQTRQVRFKIWDAGYQASVTALREAM
CCCCHHHHHHHHHHHCCCCCCCCHHHHHHHHHHHHHHHHHHHEEECCCCHHHHHHHHHHH
GDEDFDRAWAEGAALSTDEAIAYAQRGRGERKRPARGWGSLTPTERDVVRLVSEGLSNKD
CCCHHHHHHHCCCCCCCHHHHHHHHHCCCCCCCCCCCCCCCCCCHHHHHHHHHCCCCCHH
IAKRLFVSPRTVQTHLTHVYAKLGLASRVQLVDEAARRGSPS
HHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: DNA [C]

Specific reaction: Protein + DNA = Protein-DNA [C]

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 9634230; 12218036 [H]