Definition Mesoplasma florum L1, complete genome.
Accession NC_006055
Length 793,224

Click here to switch to the map view.

The map label for this gene is topA [H]

Identifier: 50365469

GI number: 50365469

Start: 760995

End: 762911

Strand: Direct

Name: topA [H]

Synonym: Mfl654

Alternate gene names: 50365469

Gene position: 760995-762911 (Clockwise)

Preceding gene: 50365462

Following gene: 50365471

Centisome position: 95.94

GC content: 29.79

Gene sequence:

>1917_bases
ATGGCAAAATATTTAGTATTACTTGAATCACCATCAAAGGTTGAAAAGATTAAACATTATTTAGAGAAAAATTTTCAAGA
AGATTCTTTTGAGGTTTTAGCTAGTGGTGGTCATATTAACAGAATAGCAGACTCTGGACCTTGAGGGCTTGGAATAGACC
TTCAAACAATGACACCAACATTTAAAATAGAAACAACAAAGAAAAAGAATGTTTCTGAAATTGTAAAAGCTGGTAAAAGT
GCGGATAAAATTATTCTTGCTTCCGATCCCGACCGTGAAGGAGAAGCTATTGCTTGACATTTAGCAAATCTTTTTGCTAA
AGATAATAAAGAAATAAAAAGAATAACATTTAATGAAATTACTGAAAGTGCTGTTGTTAAGGCTTTTGGTGAAATGAGAG
AAATAGATATAGATTTAGTTAACGCACAGTTGTCTAGACAAATGTTAGATAAAATAATCGGATATATGGTTTCTAATTCT
CTTCAAAAAAGCACAGGATTATTAAGCGCAGGTAGGGTTCAAACACCAGCATTAAAAATACTTGTTGATAGAGATAAAAT
AATTAAAGCTTTCGTTGAAACTATTTATAAAAAGATTTTTGTTATGGATTCAAAGCAAAATGTTAAATTATTTTTATACA
AAGACGATAATAACTTAGTTGTAAATGATCCAAAAAATTATTATATTTCTGAAGAACAATCTAAAGTTATTATAAATAAC
TTAGGTGAAGATTATAAATGTACTAAATATAAAGCCAAAGAATTTGAAGTAAGAAGCTTTAAACCTTATTCAACAGCTAG
TTTGCTACAGGATGGTTTTAGTAAATTGAGAATGAGTGCTGCTCAAATTACAGTTGCTGCTCAAAAACTTTATGAAGCAG
GACTTGTGACATATATAAGAACAGATTCTAATAGATATTCTAGTGATTTTGTTCTTGAAGCTAAGAATTTTATTAATAAA
AATTTTAAAGGTGATCTTTTTAAAGAAGCTGTTCCTGTAAGAACTCAAGCTAATGCGCAAGAAGCCCATGAGTCAATTAG
ACCAACAGATTTAAACCAACGACCAGAAAACATATCTTCACAAATAGAAGACAAAAATATGATTAGACTTTATAACTTAA
TTTGATGAAATACAGTTAAATCATTAATGAAAGGTCCTAGTGGTTTCTATCACAACTGAACTTTCTGAAATAATGGTTAT
GAATTTAAACAAAGTTGAAAAGAAGTATTGGATTTAGGATACAACAAATTGGATAAATTTGAAACCGATGAGGATGTTGA
GCTTGATGAAAATGATGATGAGATTTCTAATGATGATGAAATCAAGCCACCTTTTGAATTTAAGGAAAATTATGTTTTCT
CAATTAATAAAAACGCAATAGTCACAGAAGAGGCTAAAACATCTCCACCAAGAATGTTTAACCAAGCAAGTTTGGTTAGA
GAGCTAAAAGATTTGGGTATTGGAAGACCTTCAACTTATACTCCAACTCTTTCAAAATTAAAAGAACGAGAATATGCAAT
ACCACATAGAGGTAAACCATTTGAAGTTACTGAAAAAGGGTATCAAGCAGAAGAGTTTTTATATAATAAATATGAAGATT
TCTTCAATGTTAATTACACAGCTAAAATGGAAGAAAATTTAGATGAGATAGCAGAAGGTAAGTTTGATTACAAAGATTGA
ATTAAGACAATTTATGAAGACTTAAATGCTTCTGTGAAAGCTCAAATTCAAGAAGCTAAGACTAGCGATATAAAATGCCC
TAGATGTCATGAAGGTAATCTTGTATTTATTAAATCTAAATTTGGTAGAGGTAGAGGTTGTTCTAACTTCACAACAACTA
AATGCGGATATCGTGAATATGAACAAAGAGATGGTTCATGATTAGAATACGTTGCTAAGCCAAAAGAAACAAAATAA

Upstream 100 bases:

>100_bases
TTAATTTAATAATATATATAAGCCTAAAATGAAAAAAATAAATTTTAGTTGAAATTATGTTTAGAAAAGGTTTAAATTAA
TCAATGAAAGAAGTGTGGAC

Downstream 100 bases:

>100_bases
AAAAACAAGGTTTTAAAAATCCTTGTTTTTTTATTATATTTTTAAAGATTTTAAAATGGCTAAAATTTCTTCTTTTTCAG
TATTTGCTTTTAATAAAGTT

Product: DNA topoisomerase I

Products: NA

Alternate protein names: DNA topoisomerase I; Omega-protein; Relaxing enzyme; Swivelase; Untwisting enzyme [H]

Number of amino acids: Translated: 638; Mature: 637

Protein sequence:

>638_residues
MAKYLVLLESPSKVEKIKHYLEKNFQEDSFEVLASGGHINRIADSGPWGLGIDLQTMTPTFKIETTKKKNVSEIVKAGKS
ADKIILASDPDREGEAIAWHLANLFAKDNKEIKRITFNEITESAVVKAFGEMREIDIDLVNAQLSRQMLDKIIGYMVSNS
LQKSTGLLSAGRVQTPALKILVDRDKIIKAFVETIYKKIFVMDSKQNVKLFLYKDDNNLVVNDPKNYYISEEQSKVIINN
LGEDYKCTKYKAKEFEVRSFKPYSTASLLQDGFSKLRMSAAQITVAAQKLYEAGLVTYIRTDSNRYSSDFVLEAKNFINK
NFKGDLFKEAVPVRTQANAQEAHESIRPTDLNQRPENISSQIEDKNMIRLYNLIWWNTVKSLMKGPSGFYHNWTFWNNGY
EFKQSWKEVLDLGYNKLDKFETDEDVELDENDDEISNDDEIKPPFEFKENYVFSINKNAIVTEEAKTSPPRMFNQASLVR
ELKDLGIGRPSTYTPTLSKLKEREYAIPHRGKPFEVTEKGYQAEEFLYNKYEDFFNVNYTAKMEENLDEIAEGKFDYKDW
IKTIYEDLNASVKAQIQEAKTSDIKCPRCHEGNLVFIKSKFGRGRGCSNFTTTKCGYREYEQRDGSWLEYVAKPKETK

Sequences:

>Translated_638_residues
MAKYLVLLESPSKVEKIKHYLEKNFQEDSFEVLASGGHINRIADSGP*GLGIDLQTMTPTFKIETTKKKNVSEIVKAGKS
ADKIILASDPDREGEAIA*HLANLFAKDNKEIKRITFNEITESAVVKAFGEMREIDIDLVNAQLSRQMLDKIIGYMVSNS
LQKSTGLLSAGRVQTPALKILVDRDKIIKAFVETIYKKIFVMDSKQNVKLFLYKDDNNLVVNDPKNYYISEEQSKVIINN
LGEDYKCTKYKAKEFEVRSFKPYSTASLLQDGFSKLRMSAAQITVAAQKLYEAGLVTYIRTDSNRYSSDFVLEAKNFINK
NFKGDLFKEAVPVRTQANAQEAHESIRPTDLNQRPENISSQIEDKNMIRLYNLI**NTVKSLMKGPSGFYHN*TF*NNGY
EFKQS*KEVLDLGYNKLDKFETDEDVELDENDDEISNDDEIKPPFEFKENYVFSINKNAIVTEEAKTSPPRMFNQASLVR
ELKDLGIGRPSTYTPTLSKLKEREYAIPHRGKPFEVTEKGYQAEEFLYNKYEDFFNVNYTAKMEENLDEIAEGKFDYKD*
IKTIYEDLNASVKAQIQEAKTSDIKCPRCHEGNLVFIKSKFGRGRGCSNFTTTKCGYREYEQRDGS*LEYVAKPKETK
>Mature_637_residues
AKYLVLLESPSKVEKIKHYLEKNFQEDSFEVLASGGHINRIADSGP*GLGIDLQTMTPTFKIETTKKKNVSEIVKAGKSA
DKIILASDPDREGEAIA*HLANLFAKDNKEIKRITFNEITESAVVKAFGEMREIDIDLVNAQLSRQMLDKIIGYMVSNSL
QKSTGLLSAGRVQTPALKILVDRDKIIKAFVETIYKKIFVMDSKQNVKLFLYKDDNNLVVNDPKNYYISEEQSKVIINNL
GEDYKCTKYKAKEFEVRSFKPYSTASLLQDGFSKLRMSAAQITVAAQKLYEAGLVTYIRTDSNRYSSDFVLEAKNFINKN
FKGDLFKEAVPVRTQANAQEAHESIRPTDLNQRPENISSQIEDKNMIRLYNLI**NTVKSLMKGPSGFYHN*TF*NNGYE
FKQS*KEVLDLGYNKLDKFETDEDVELDENDDEISNDDEIKPPFEFKENYVFSINKNAIVTEEAKTSPPRMFNQASLVRE
LKDLGIGRPSTYTPTLSKLKEREYAIPHRGKPFEVTEKGYQAEEFLYNKYEDFFNVNYTAKMEENLDEIAEGKFDYKD*I
KTIYEDLNASVKAQIQEAKTSDIKCPRCHEGNLVFIKSKFGRGRGCSNFTTTKCGYREYEQRDGS*LEYVAKPKETK

Specific function: The reaction catalyzed by topoisomerases leads to the conversion of one topological isomer of DNA to another [H]

COG id: COG0550

COG function: function code L; Topoisomerase IA

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 Toprim domain [H]

Homologues:

Organism=Homo sapiens, GI10835218, Length=501, Percent_Identity=23.9520958083832, Blast_Score=90, Evalue=5e-18,
Organism=Homo sapiens, GI4507635, Length=537, Percent_Identity=22.5325884543762, Blast_Score=89, Evalue=1e-17,
Organism=Escherichia coli, GI1787529, Length=661, Percent_Identity=28.8956127080182, Blast_Score=236, Evalue=4e-63,
Organism=Escherichia coli, GI1788061, Length=561, Percent_Identity=22.6381461675579, Blast_Score=83, Evalue=6e-17,
Organism=Caenorhabditis elegans, GI17555378, Length=476, Percent_Identity=24.1596638655462, Blast_Score=103, Evalue=2e-22,
Organism=Drosophila melanogaster, GI24640096, Length=530, Percent_Identity=22.0754716981132, Blast_Score=86, Evalue=7e-17,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR003601
- InterPro:   IPR013497
- InterPro:   IPR013824
- InterPro:   IPR013825
- InterPro:   IPR000380
- InterPro:   IPR003602
- InterPro:   IPR013498
- InterPro:   IPR005733
- InterPro:   IPR006171 [H]

Pfam domain/function: PF01131 Topoisom_bac; PF01751 Toprim; PF01396 zf-C4_Topoisom [H]

EC number: =5.99.1.2 [H]

Molecular weight: Translated: 71726; Mature: 71595

Theoretical pI: Translated: 6.45; Mature: 6.45

Prosite motif: PS00396 TOPOISOMERASE_I_PROK ; PS00430 TONB_DEPENDENT_REC_1

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

0.8 %Cys     (Translated Protein)
1.7 %Met     (Translated Protein)
2.5 %Cys+Met (Translated Protein)
0.8 %Cys     (Mature Protein)
1.6 %Met     (Mature Protein)
2.4 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MAKYLVLLESPSKVEKIKHYLEKNFQEDSFEVLASGGHINRIADSGPGLGIDLQTMTPTF
CCEEEEEECCCHHHHHHHHHHHHCCCCCCHHHHHCCCCEEECCCCCCCCCEEEEECCCEE
KIETTKKKNVSEIVKAGKSADKIILASDPDREGEAIAHLANLFAKDNKEIKRITFNEITE
EEECCCCCCHHHHHHCCCCCCEEEEECCCCCCHHHHHHHHHHHHCCCCHHHHHHHHHHHH
SAVVKAFGEMREIDIDLVNAQLSRQMLDKIIGYMVSNSLQKSTGLLSAGRVQTPALKILV
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCEEEEEE
DRDKIIKAFVETIYKKIFVMDSKQNVKLFLYKDDNNLVVNDPKNYYISEEQSKVIINNLG
CHHHHHHHHHHHHHHHHEEECCCCCEEEEEEECCCCEEEECCCCCEECCCCCCHHHHCCC
EDYKCTKYKAKEFEVRSFKPYSTASLLQDGFSKLRMSAAQITVAAQKLYEAGLVTYIRTD
CCCEECCCCCCCEECCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCEEEEEEC
SNRYSSDFVLEAKNFINKNFKGDLFKEAVPVRTQANAQEAHESIRPTDLNQRPENISSQI
CCCCCCCEEEEHHHHHCCCCCCCHHHHCCCCCCCCCHHHHHHCCCCCCCCCCCHHHHHHC
EDKNMIRLYNLINTVKSLMKGPSGFYHNTFNNGYEFKQSKEVLDLGYNKLDKFETDEDVE
CCCHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCHHHHHHHHHHCCHHHHCCCCCCCCC
LDENDDEISNDDEIKPPFEFKENYVFSINKNAIVTEEAKTSPPRMFNQASLVRELKDLGI
CCCCCCCCCCCCCCCCCHHCCCCEEEEECCCEEEECCCCCCCCHHHHHHHHHHHHHHCCC
GRPSTYTPTLSKLKEREYAIPHRGKPFEVTEKGYQAEEFLYNKYEDFFNVNYTAKMEENL
CCCCCCCHHHHHHHHHHCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHCCCEEEHHHHHH
DEIAEGKFDYKDIKTIYEDLNASVKAQIQEAKTSDIKCPRCHEGNLVFIKSKFGRGRGCS
HHHHCCCCCHHHHHHHHHHHCCHHHHHHHHHCCCCCCCCCCCCCCEEEEEECCCCCCCCC
NFTTTKCGYREYEQRDGSLEYVAKPKETK
CCCCCCCCCHHHHHCCCCEEEECCCCCCC
>Mature Secondary Structure 
AKYLVLLESPSKVEKIKHYLEKNFQEDSFEVLASGGHINRIADSGPGLGIDLQTMTPTF
CEEEEEECCCHHHHHHHHHHHHCCCCCCHHHHHCCCCEEECCCCCCCCCEEEEECCCEE
KIETTKKKNVSEIVKAGKSADKIILASDPDREGEAIAHLANLFAKDNKEIKRITFNEITE
EEECCCCCCHHHHHHCCCCCCEEEEECCCCCCHHHHHHHHHHHHCCCCHHHHHHHHHHHH
SAVVKAFGEMREIDIDLVNAQLSRQMLDKIIGYMVSNSLQKSTGLLSAGRVQTPALKILV
HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCEEEEEE
DRDKIIKAFVETIYKKIFVMDSKQNVKLFLYKDDNNLVVNDPKNYYISEEQSKVIINNLG
CHHHHHHHHHHHHHHHHEEECCCCCEEEEEEECCCCEEEECCCCCEECCCCCCHHHHCCC
EDYKCTKYKAKEFEVRSFKPYSTASLLQDGFSKLRMSAAQITVAAQKLYEAGLVTYIRTD
CCCEECCCCCCCEECCCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCEEEEEEC
SNRYSSDFVLEAKNFINKNFKGDLFKEAVPVRTQANAQEAHESIRPTDLNQRPENISSQI
CCCCCCCEEEEHHHHHCCCCCCCHHHHCCCCCCCCCHHHHHHCCCCCCCCCCCHHHHHHC
EDKNMIRLYNLINTVKSLMKGPSGFYHNTFNNGYEFKQSKEVLDLGYNKLDKFETDEDVE
CCCHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCHHHHHHHHHHCCHHHHCCCCCCCCC
LDENDDEISNDDEIKPPFEFKENYVFSINKNAIVTEEAKTSPPRMFNQASLVRELKDLGI
CCCCCCCCCCCCCCCCCHHCCCCEEEEECCCEEEECCCCCCCCHHHHHHHHHHHHHHCCC
GRPSTYTPTLSKLKEREYAIPHRGKPFEVTEKGYQAEEFLYNKYEDFFNVNYTAKMEENL
CCCCCCCHHHHHHHHHHCCCCCCCCCCCCCCCCCCHHHHHHHHHHHHHCCCEEEHHHHHH
DEIAEGKFDYKDIKTIYEDLNASVKAQIQEAKTSDIKCPRCHEGNLVFIKSKFGRGRGCS
HHHHCCCCCHHHHHHHHHHHCCHHHHHHHHHCCCCCCCCCCCCCCEEEEEECCCCCCCCC
NFTTTKCGYREYEQRDGSLEYVAKPKETK
CCCCCCCCCHHHHHCCCCEEEECCCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 10688204 [H]