Definition Leptospira interrogans serovar Copenhageni str. Fiocruz L1-130 chromosome chromosome I, complete sequence.
Accession NC_005823
Length 4,277,185

Click here to switch to the map view.

The map label for this gene is ydiF [H]

Identifier: 45656289

GI number: 45656289

Start: 445216

End: 447156

Strand: Direct

Name: ydiF [H]

Synonym: LIC10389

Alternate gene names: 45656289

Gene position: 445216-447156 (Clockwise)

Preceding gene: 304570512

Following gene: 45656290

Centisome position: 10.41

GC content: 35.86

Gene sequence:

>1941_bases
TTGCTTCAATTTATCGACATAAAACATCAGTACGGTTCTAACGTATTGTTTAACGGTTTTTCTTGGCACATCAAACCGGG
GTCTCGCGTTTGTCTTGTGGGTCCAAACGGTTCTGGTAAATCGACTTTGTTTAGGATCGCAGAGGGAAAATTTATTCCGG
ACGAAGGAAGTGTAGCAAAATCTAAAAACACTGAAATTTCAGTATTCCAACAGATTCCAGAATTTAATCCTGAAGCATTG
GTCATTGATACTGCATTAGAAAAACATAAACATTATCGGGAATATTCAGAACGTTTGAAAGAAATCAATCGTAAGTTCGA
TCTTGTTTCTCACGATTCGAAGGAATTTACTACGATTCTGGATGAACAAAGCGCTTTAGAAGAATATGCTTTTACATATG
GAGTACACGAACTTGAATCTAAAGCTCGCAAAGTTTTAGGTGGATTAGGGTTTTCTAATGTTCAGATGGAAATGAAAGTT
CGGGAATTTTCTCCAGGTTATCAACATCGTCTTGGTTTAGCAATTACTCTTTTGAATCCGGGCAACTTATTGTTGTTAGA
TGAACCTACAAATCATTTGGATAATACTTCTAAAGAATGGTTGGCGGACTATCTTAATTCTACAGGTCAATCTTTTGTAC
TCGTAACTCACGATCCGGAATTTTTGGATGCGACTTGTGATACGATTGCGGAACTTTCCTCTTCCGAAGTTATAGAATTT
CGGGGAACCTTAGAGGAATATTTCGAACATAAAAATGAACTTCAAGAAAAACTTAGAGCTCAGTACCGAAAAGAAGAAAC
TTATCTCAAAAAGAGAATGGAATGGATCGAACGTTTTCGCGCAAAGGCTACAAAAGCGAAACAAGTCCAATCCGCGATCA
AAAAACTCGAAAAAAGAAATAAGGTAGAAGCGCCTGAGGAATCCTTTTGGAATTCCAAGTCGGATTATCGTTTTAATTTT
ATATCTTCCGGAAAAATTACTGTAAGAATTGAAGATGGAGCTTTCTCATATTCGGATAAAACTCCATCTATTTTTAGCGG
CGCTAATCTGGAAATTTCAGCGGGTGATAAAATTGCGGTAGTGGGTCCTAATGGTGCAGGAAAGTCCACGTTTCTTCGTT
GTTTATTAGAGATTCATAAATTAACTTCCGGTAAAATTTATTATGGACCTAAAACGAAAATCGGTTATTTCTCACAAAAT
CATCACGAGGAATTAGATCCTTCTAAAAATCTTATTCAAACGGTTATGTCCGCATACCCGGATCTTTCGGAACAACAGGC
CAGAAGTCTTTTAGGTTATTTTTCTTTTTCTGACGATTCTGTTTATAAACAAACCAGTCTTCTTTCGGGTGGAGAACAAA
GTCGTCTTCGTCTTGCAATGCTTGTTCGTTTTCCTGCTAATTCTATTTTTTTGGATGAACCTACCAACCATCTTGATTTA
GTAGTACGGGACAATTTACTGAGAGCATTGATGGAATATGAAGGTTCTCTTTTAATTATTTCTCACGATCCTGAATTCTT
AAGAAGTCTTTGTAATCGTACTATTTCTGTGGACAAGGGACAAATTCGGGATTTTAACTGCACGTTTGAGGATTATTTAA
AATATAATTTGCAAGAGACCACATCATCTAAACAACAAATCGGAAACTTGGTTTTTAAAAAAGAGGAAACAGGGCAAACG
CGCTCTAAAAGAAATTCAGATAAAAACAGAATCAAAAAAATTCAGAAAGATTTAGAACAACTGGAAACTAAGATCGAACT
TTTAGAAAAATCAAAAAAGAATTTGGAAGAAGTGTTAGCCGATCCCGACTTTTTTAAAAATCGTAGTTATCAATTAGAAT
TGGACAATTTAAACGAAACCAAAAACGAAATTACACGTTTGACTTTGGAATGGGAGTCACTTCAATTAGAGTTCGAAGAA
CTTTCTGGAACTGTAAATTAG

Upstream 100 bases:

>100_bases
AAGAGCTCGCAGTAAAAGGTAAGAAATAATTTCTTTCCGGTCCGTCTGTTTTTGACGGACTAATTCCTGCTCGTTTTTAG
CTTCCCTAACATTTCTATCC

Downstream 100 bases:

>100_bases
GAATTACTAAAAGAATCTTATTTAAAATAAGGTTGTTGAAAAATTCCATAGTGAAGATTTGTAAAATTGCTTCAATTGTC
CGTTTCAATACAACGAAAAC

Product: ABC transporter ATP-binding protein

Products: NA

Alternate protein names: NA

Number of amino acids: Translated: 646; Mature: 646

Protein sequence:

>646_residues
MLQFIDIKHQYGSNVLFNGFSWHIKPGSRVCLVGPNGSGKSTLFRIAEGKFIPDEGSVAKSKNTEISVFQQIPEFNPEAL
VIDTALEKHKHYREYSERLKEINRKFDLVSHDSKEFTTILDEQSALEEYAFTYGVHELESKARKVLGGLGFSNVQMEMKV
REFSPGYQHRLGLAITLLNPGNLLLLDEPTNHLDNTSKEWLADYLNSTGQSFVLVTHDPEFLDATCDTIAELSSSEVIEF
RGTLEEYFEHKNELQEKLRAQYRKEETYLKKRMEWIERFRAKATKAKQVQSAIKKLEKRNKVEAPEESFWNSKSDYRFNF
ISSGKITVRIEDGAFSYSDKTPSIFSGANLEISAGDKIAVVGPNGAGKSTFLRCLLEIHKLTSGKIYYGPKTKIGYFSQN
HHEELDPSKNLIQTVMSAYPDLSEQQARSLLGYFSFSDDSVYKQTSLLSGGEQSRLRLAMLVRFPANSIFLDEPTNHLDL
VVRDNLLRALMEYEGSLLIISHDPEFLRSLCNRTISVDKGQIRDFNCTFEDYLKYNLQETTSSKQQIGNLVFKKEETGQT
RSKRNSDKNRIKKIQKDLEQLETKIELLEKSKKNLEEVLADPDFFKNRSYQLELDNLNETKNEITRLTLEWESLQLEFEE
LSGTVN

Sequences:

>Translated_646_residues
MLQFIDIKHQYGSNVLFNGFSWHIKPGSRVCLVGPNGSGKSTLFRIAEGKFIPDEGSVAKSKNTEISVFQQIPEFNPEAL
VIDTALEKHKHYREYSERLKEINRKFDLVSHDSKEFTTILDEQSALEEYAFTYGVHELESKARKVLGGLGFSNVQMEMKV
REFSPGYQHRLGLAITLLNPGNLLLLDEPTNHLDNTSKEWLADYLNSTGQSFVLVTHDPEFLDATCDTIAELSSSEVIEF
RGTLEEYFEHKNELQEKLRAQYRKEETYLKKRMEWIERFRAKATKAKQVQSAIKKLEKRNKVEAPEESFWNSKSDYRFNF
ISSGKITVRIEDGAFSYSDKTPSIFSGANLEISAGDKIAVVGPNGAGKSTFLRCLLEIHKLTSGKIYYGPKTKIGYFSQN
HHEELDPSKNLIQTVMSAYPDLSEQQARSLLGYFSFSDDSVYKQTSLLSGGEQSRLRLAMLVRFPANSIFLDEPTNHLDL
VVRDNLLRALMEYEGSLLIISHDPEFLRSLCNRTISVDKGQIRDFNCTFEDYLKYNLQETTSSKQQIGNLVFKKEETGQT
RSKRNSDKNRIKKIQKDLEQLETKIELLEKSKKNLEEVLADPDFFKNRSYQLELDNLNETKNEITRLTLEWESLQLEFEE
LSGTVN
>Mature_646_residues
MLQFIDIKHQYGSNVLFNGFSWHIKPGSRVCLVGPNGSGKSTLFRIAEGKFIPDEGSVAKSKNTEISVFQQIPEFNPEAL
VIDTALEKHKHYREYSERLKEINRKFDLVSHDSKEFTTILDEQSALEEYAFTYGVHELESKARKVLGGLGFSNVQMEMKV
REFSPGYQHRLGLAITLLNPGNLLLLDEPTNHLDNTSKEWLADYLNSTGQSFVLVTHDPEFLDATCDTIAELSSSEVIEF
RGTLEEYFEHKNELQEKLRAQYRKEETYLKKRMEWIERFRAKATKAKQVQSAIKKLEKRNKVEAPEESFWNSKSDYRFNF
ISSGKITVRIEDGAFSYSDKTPSIFSGANLEISAGDKIAVVGPNGAGKSTFLRCLLEIHKLTSGKIYYGPKTKIGYFSQN
HHEELDPSKNLIQTVMSAYPDLSEQQARSLLGYFSFSDDSVYKQTSLLSGGEQSRLRLAMLVRFPANSIFLDEPTNHLDL
VVRDNLLRALMEYEGSLLIISHDPEFLRSLCNRTISVDKGQIRDFNCTFEDYLKYNLQETTSSKQQIGNLVFKKEETGQT
RSKRNSDKNRIKKIQKDLEQLETKIELLEKSKKNLEEVLADPDFFKNRSYQLELDNLNETKNEITRLTLEWESLQLEFEE
LSGTVN

Specific function: Unknown

COG id: COG0488

COG function: function code R; ATPase components of ABC transporters with duplicated ATPase domains

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Unknown [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 2 ABC transporter domains [H]

Homologues:

Organism=Homo sapiens, GI148612853, Length=526, Percent_Identity=30.6083650190114, Blast_Score=232, Evalue=9e-61,
Organism=Homo sapiens, GI27881506, Length=549, Percent_Identity=27.8688524590164, Blast_Score=205, Evalue=8e-53,
Organism=Homo sapiens, GI10947137, Length=549, Percent_Identity=27.8688524590164, Blast_Score=205, Evalue=8e-53,
Organism=Homo sapiens, GI10947135, Length=526, Percent_Identity=29.277566539924, Blast_Score=178, Evalue=1e-44,
Organism=Homo sapiens, GI69354671, Length=526, Percent_Identity=29.277566539924, Blast_Score=178, Evalue=2e-44,
Organism=Escherichia coli, GI1789751, Length=652, Percent_Identity=31.5950920245399, Blast_Score=303, Evalue=2e-83,
Organism=Escherichia coli, GI1787041, Length=542, Percent_Identity=30.4428044280443, Blast_Score=258, Evalue=9e-70,
Organism=Escherichia coli, GI1787182, Length=642, Percent_Identity=28.816199376947, Blast_Score=230, Evalue=2e-61,
Organism=Escherichia coli, GI2367384, Length=554, Percent_Identity=29.2418772563177, Blast_Score=219, Evalue=4e-58,
Organism=Escherichia coli, GI1787029, Length=202, Percent_Identity=28.2178217821782, Blast_Score=82, Evalue=1e-16,
Organism=Escherichia coli, GI1788225, Length=213, Percent_Identity=26.2910798122066, Blast_Score=79, Evalue=1e-15,
Organism=Escherichia coli, GI1789891, Length=215, Percent_Identity=26.046511627907, Blast_Score=74, Evalue=3e-14,
Organism=Escherichia coli, GI1787105, Length=248, Percent_Identity=27.0161290322581, Blast_Score=69, Evalue=7e-13,
Organism=Escherichia coli, GI1788506, Length=196, Percent_Identity=26.0204081632653, Blast_Score=67, Evalue=3e-12,
Organism=Escherichia coli, GI1789962, Length=199, Percent_Identity=26.6331658291457, Blast_Score=66, Evalue=6e-12,
Organism=Escherichia coli, GI1787500, Length=240, Percent_Identity=23.75, Blast_Score=65, Evalue=2e-11,
Organism=Caenorhabditis elegans, GI17553372, Length=539, Percent_Identity=30.0556586270872, Blast_Score=222, Evalue=5e-58,
Organism=Caenorhabditis elegans, GI17555318, Length=531, Percent_Identity=28.4369114877589, Blast_Score=209, Evalue=3e-54,
Organism=Caenorhabditis elegans, GI17559834, Length=552, Percent_Identity=27.7173913043478, Blast_Score=196, Evalue=3e-50,
Organism=Saccharomyces cerevisiae, GI6321121, Length=535, Percent_Identity=30.2803738317757, Blast_Score=240, Evalue=5e-64,
Organism=Saccharomyces cerevisiae, GI6320874, Length=527, Percent_Identity=27.8937381404175, Blast_Score=189, Evalue=2e-48,
Organism=Saccharomyces cerevisiae, GI6324314, Length=391, Percent_Identity=26.5984654731458, Blast_Score=131, Evalue=3e-31,
Organism=Saccharomyces cerevisiae, GI6323278, Length=400, Percent_Identity=25.5, Blast_Score=120, Evalue=5e-28,
Organism=Saccharomyces cerevisiae, GI6325030, Length=411, Percent_Identity=27.007299270073, Blast_Score=114, Evalue=7e-26,
Organism=Drosophila melanogaster, GI24666836, Length=532, Percent_Identity=31.9548872180451, Blast_Score=233, Evalue=2e-61,
Organism=Drosophila melanogaster, GI24642252, Length=562, Percent_Identity=29.1814946619217, Blast_Score=216, Evalue=3e-56,
Organism=Drosophila melanogaster, GI18859989, Length=562, Percent_Identity=29.1814946619217, Blast_Score=216, Evalue=3e-56,
Organism=Drosophila melanogaster, GI24641342, Length=551, Percent_Identity=28.6751361161525, Blast_Score=202, Evalue=5e-52,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR003439
- InterPro:   IPR017871
- InterPro:   IPR003593 [H]

Pfam domain/function: PF00005 ABC_tran [H]

EC number: NA

Molecular weight: Translated: 74162; Mature: 74162

Theoretical pI: Translated: 6.16; Mature: 6.16

Prosite motif: PS00211 ABC_TRANSPORTER_1 ; PS50893 ABC_TRANSPORTER_2

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.8 %Cys     (Translated Protein)
1.1 %Met     (Translated Protein)
1.9 %Cys+Met (Translated Protein)
0.8 %Cys     (Mature Protein)
1.1 %Met     (Mature Protein)
1.9 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MLQFIDIKHQYGSNVLFNGFSWHIKPGSRVCLVGPNGSGKSTLFRIAEGKFIPDEGSVAK
CCEEEEEHHHHCCCEEECCEEEEECCCCEEEEECCCCCCCCCEEEEECCCCCCCCCCCCC
SKNTEISVFQQIPEFNPEALVIDTALEKHKHYREYSERLKEINRKFDLVSHDSKEFTTIL
CCCCCHHHHHHCCCCCCCEEEEHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHH
DEQSALEEYAFTYGVHELESKARKVLGGLGFSNVQMEMKVREFSPGYQHRLGLAITLLNP
HHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCEEEEEEEECCCCCCCEECEEEEEEECC
GNLLLLDEPTNHLDNTSKEWLADYLNSTGQSFVLVTHDPEFLDATCDTIAELSSSEVIEF
CCEEEEECCCCCCCCCHHHHHHHHHCCCCCEEEEEECCCHHHHHHHHHHHHCCCCCHHHH
RGTLEEYFEHKNELQEKLRAQYRKEETYLKKRMEWIERFRAKATKAKQVQSAIKKLEKRN
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCC
KVEAPEESFWNSKSDYRFNFISSGKITVRIEDGAFSYSDKTPSIFSGANLEISAGDKIAV
CCCCCHHHHCCCCCCEEEEEEECCEEEEEEECCCEECCCCCCCEECCCCEEEECCCEEEE
VGPNGAGKSTFLRCLLEIHKLTSGKIYYGPKTKIGYFSQNHHEELDPSKNLIQTVMSAYP
ECCCCCCHHHHHHHHHHHHHCCCCEEEECCCCCEECCCCCCCCCCCCHHHHHHHHHHHCC
DLSEQQARSLLGYFSFSDDSVYKQTSLLSGGEQSRLRLAMLVRFPANSIFLDEPTNHLDL
CCCHHHHHHHHHHEECCCCCHHHHHHHHCCCCHHHEEEEEEEECCCCEEEECCCCCCEEE
VVRDNLLRALMEYEGSLLIISHDPEFLRSLCNRTISVDKGQIRDFNCTFEDYLKYNLQET
EEHHHHHHHHHHCCCCEEEEECCHHHHHHHHCCCEECCCCCCEECCCCHHHHHHHHHHHH
TSSKQQIGNLVFKKEETGQTRSKRNSDKNRIKKIQKDLEQLETKIELLEKSKKNLEEVLA
CCHHHHHHHHHEECCCCCCHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHC
DPDFFKNRSYQLELDNLNETKNEITRLTLEWESLQLEFEELSGTVN
CCHHHCCCCEEEEECCCCCHHHHHEEEEEEEHHHEEEHHHCCCCCC
>Mature Secondary Structure
MLQFIDIKHQYGSNVLFNGFSWHIKPGSRVCLVGPNGSGKSTLFRIAEGKFIPDEGSVAK
CCEEEEEHHHHCCCEEECCEEEEECCCCEEEEECCCCCCCCCEEEEECCCCCCCCCCCCC
SKNTEISVFQQIPEFNPEALVIDTALEKHKHYREYSERLKEINRKFDLVSHDSKEFTTIL
CCCCCHHHHHHCCCCCCCEEEEHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCHHHHHHH
DEQSALEEYAFTYGVHELESKARKVLGGLGFSNVQMEMKVREFSPGYQHRLGLAITLLNP
HHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCEEEEEEEECCCCCCCEECEEEEEEECC
GNLLLLDEPTNHLDNTSKEWLADYLNSTGQSFVLVTHDPEFLDATCDTIAELSSSEVIEF
CCEEEEECCCCCCCCCHHHHHHHHHCCCCCEEEEEECCCHHHHHHHHHHHHCCCCCHHHH
RGTLEEYFEHKNELQEKLRAQYRKEETYLKKRMEWIERFRAKATKAKQVQSAIKKLEKRN
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCC
KVEAPEESFWNSKSDYRFNFISSGKITVRIEDGAFSYSDKTPSIFSGANLEISAGDKIAV
CCCCCHHHHCCCCCCEEEEEEECCEEEEEEECCCEECCCCCCCEECCCCEEEECCCEEEE
VGPNGAGKSTFLRCLLEIHKLTSGKIYYGPKTKIGYFSQNHHEELDPSKNLIQTVMSAYP
ECCCCCCHHHHHHHHHHHHHCCCCEEEECCCCCEECCCCCCCCCCCCHHHHHHHHHHHCC
DLSEQQARSLLGYFSFSDDSVYKQTSLLSGGEQSRLRLAMLVRFPANSIFLDEPTNHLDL
CCCHHHHHHHHHHEECCCCCHHHHHHHHCCCCHHHEEEEEEEECCCCEEEECCCCCCEEE
VVRDNLLRALMEYEGSLLIISHDPEFLRSLCNRTISVDKGQIRDFNCTFEDYLKYNLQET
EEHHHHHHHHHHCCCCEEEEECCHHHHHHHHCCCEECCCCCCEECCCCHHHHHHHHHHHH
TSSKQQIGNLVFKKEETGQTRSKRNSDKNRIKKIQKDLEQLETKIELLEKSKKNLEEVLA
CCHHHHHHHHHEECCCCCCHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHC
DPDFFKNRSYQLELDNLNETKNEITRLTLEWESLQLEFEELSGTVN
CCHHHCCCCEEEEECCCCCHHHHHEEEEEEEHHHEEEHHHCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Alpha Beta

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 9202461; 9384377 [H]