Definition Herpetosiphon aurantiacus ATCC 23779 chromosome, complete genome.
Accession NC_009972
Length 6,346,587

Click here to switch to the map view.

The map label for this gene is topA [H]

Identifier: 159900902

GI number: 159900902

Start: 5606211

End: 5608592

Strand: Direct

Name: topA [H]

Synonym: Haur_4389

Alternate gene names: 159900902

Gene position: 5606211-5608592 (Clockwise)

Preceding gene: 159900888

Following gene: 159900903

Centisome position: 88.33

GC content: 50.46

Gene sequence:

>2382_bases
ATGGATCATAAATTGGTGATTGTTGAGTCGCCAGCCAAAGCAAAAACTATTCAAAAATATCTGGGTGCTGGCTATCGCGT
TATGGCGAGTATGGGCCATGTGCGTGATTTGCCCAAGAGTAAAATTGGCATTGATATTGACAATGATTTTAGCCCTGTCT
ATGAAATTAGCGAGGGCAAAGATAAGCTCATTGCCGAATTGAAGCGCGAAATCAAGACTGCTGATGCTATTTACCTCGCA
ACCGACCACGACCGCGAAGGCGAGGCGATCGCTTGGCATATTTTACAAGCAGCTAATATTGGCAAACGTAAGCCAGTCTA
TCGCATTACCTTTAACGAAATTACCAAGGATTCGATTCAGCACGCCATTCGCAATCCGCGCGAAATCGACGCAAACCTAG
TTGATGCCCAACAGGCACGACGGGTGCTTGATCGCTTGGTTGGCTATAAAATTTCACCAATTTTGTGGGCCAAGGTGCGG
CGCGGGCTTTCGGCTGGGCGGGTGCAATCGGTTGCTGTGCGTATGGTGGTTGAGCGTGAACGCGAAATCGAAAGCTTCGT
GCCCAAAGAATATTGGACGATCGAGGCCGATTTATCGCCAGCTGGGCTGAAGAAACTTGGCAAGCACGATATTTTTCGCG
CAATCTTGCATGCTCGCAATGGCAAAAAGCTCGATAAATTTGCGATTCCTAGCAAAGATGCTGCTGATGCAGTTTTGGCT
GCCTTGGAAGGGGCAAATTATCTTGTTGGCACTGTAACCCGCAAGGATAAACGGCGCTCGCCAGCCCCGCCATTTATCAC
CAGTACCCTGCAACAAGAAGCTAGCCGCAAGCTTGGGTTTAGCTCCAAACGCACTATGCAAGTGGCCCAAAAACTGTATG
AAGGGGTCGATATTGGTGGCAAAGATGGTACAGTTGGTCTGATTACCTATATGCGTACCGATTCAACCAACGTTTCAGTC
GATGCCCAAACCGAGGCTCGTACACTGATTACTGAACTCTATGGCAAAGAGTACGTTCCAGCTAAGCCCAATATCTACAA
AACCAAGGCTAAAGGTGCGCAGGAAGCTCACGAGGCGATCCGCCCAACCAGCGTAGTCCGCCGCCCTGATCAATTAAAAA
CAGCGCTTGGCCGCGATGAGTTTCGGCTTTACGACTTGATCTGGAAGCGCTTTATGGCTTCGCAGATGGCGGCGGCAATT
TTTGATAGTACGAGCGTCGATATTGGTGCTGGGGCCGGAATCAAAACTGCTGCTGGAGCGCCATTTACCTTCCGCGCAAC
TGGCTCAGTGCTCAAATTCAATGGCTTTTTGGCAGTCTACAACGTCAGCCTCGATGAAGGCGACGAAGATGAAGACAAAG
AGGCCTTGTTGCCGCCGCTCAACGAAGGCCAAGCCCTCGATTTGCATGATCTCTTTGGCGAGCAACATTTCACTACGCCA
CCACCACGCTATACCGAAGCAACCTTGGTTAAGCAGATGGAAAGTGAAGGGATTGGTCGCCCATCAACCTATGCGCCGAC
GATCTCAACCATCGTTGCCCGCGAATATGTTGAGTTGGTCGAAAAGAAATTGATGCCCACCACCTTAGGCCGGGTTGTGA
CCGACTTGCTAGTTGAGCACTTCAAAGATATTGTCGATTACAACTTTACTTCGGATATGGAACAGCGGCTTGATGATATC
GCTGAAGGCCAACGTCGTTGGGTGCCAGTGCTGCGCGAATTTTACGATCCGTTTGCTGTACGCTTGCATGCTGCCGAAAC
CGAAATGCGCAACGTCAAGCGCGAAGAAATCAAAACTGAATTGCCCTGCCCGCAATGTGGCACGCATCTGGTGATCAAAT
GGGGGCGTAATGGCGAATTCTTGGCTTGTTCGCGTTACCCTGAGTGTAGCTGGACGGGTGATTTAGAGCGTGATGGCGAT
GGCGGGATTCATATCGCCTCGCAGCCTGAAATTTTTGGCAACACCAATTGCCCTGAATGCGACAACCCAATGAGCCTCAA
AAAAGGTCGTTTTGGGCCGTTTCTCGCCTGTAACAACTACCCAACTTGTAAGGGTATTCGCAAAGTACGGGCGCAAGGCA
AAGATTTTGTGGTGATTCCGCCGCCTAAGCCAACCGAGGAAAAATGCCCCAAATGTAACCGCCCAATGGTGCAAAAAGAG
GGCAAATTTGGGCCATTCTTATCATGCACCGGCTACCCTGAATGCCGCTCGATTGTACGATTAACGCCCAACGATGCCCC
AACCTGCCCTCAATGTGGTGAGGGTAAAGTTGTCGCCAAACGTGCGCGTGGTGGCCGTACCTTCTTCTCTTGCACACGCT
ACCCCGATTGTACGTATGCGAGTAACGCCTTACCTGTGGCGGTTTCCGAAGAAGTAGCCTAA

Upstream 100 bases:

>100_bases
CTAAAGCGACGCTGCCCCAGTACACGTCAACTTTGAACTGATTCGCCGCGTTTTGAATGCGTCGGTTGGTGGTATAGTGT
GAACTTTTAAGGAAAACCCT

Downstream 100 bases:

>100_bases
GTTTTTTGCTTGACGCAAGGTTTTATCGTATTTCGATAAAACCTTGCGTTGCTGTTTAAAGGAGCTGATGGTGATCAAGC
ATCTGGCTGAGGCGTTGCGT

Product: DNA topoisomerase I

Products: NA

Alternate protein names: DNA topoisomerase I; Omega-protein; Relaxing enzyme; Swivelase; Untwisting enzyme [H]

Number of amino acids: Translated: 793; Mature: 793

Protein sequence:

>793_residues
MDHKLVIVESPAKAKTIQKYLGAGYRVMASMGHVRDLPKSKIGIDIDNDFSPVYEISEGKDKLIAELKREIKTADAIYLA
TDHDREGEAIAWHILQAANIGKRKPVYRITFNEITKDSIQHAIRNPREIDANLVDAQQARRVLDRLVGYKISPILWAKVR
RGLSAGRVQSVAVRMVVEREREIESFVPKEYWTIEADLSPAGLKKLGKHDIFRAILHARNGKKLDKFAIPSKDAADAVLA
ALEGANYLVGTVTRKDKRRSPAPPFITSTLQQEASRKLGFSSKRTMQVAQKLYEGVDIGGKDGTVGLITYMRTDSTNVSV
DAQTEARTLITELYGKEYVPAKPNIYKTKAKGAQEAHEAIRPTSVVRRPDQLKTALGRDEFRLYDLIWKRFMASQMAAAI
FDSTSVDIGAGAGIKTAAGAPFTFRATGSVLKFNGFLAVYNVSLDEGDEDEDKEALLPPLNEGQALDLHDLFGEQHFTTP
PPRYTEATLVKQMESEGIGRPSTYAPTISTIVAREYVELVEKKLMPTTLGRVVTDLLVEHFKDIVDYNFTSDMEQRLDDI
AEGQRRWVPVLREFYDPFAVRLHAAETEMRNVKREEIKTELPCPQCGTHLVIKWGRNGEFLACSRYPECSWTGDLERDGD
GGIHIASQPEIFGNTNCPECDNPMSLKKGRFGPFLACNNYPTCKGIRKVRAQGKDFVVIPPPKPTEEKCPKCNRPMVQKE
GKFGPFLSCTGYPECRSIVRLTPNDAPTCPQCGEGKVVAKRARGGRTFFSCTRYPDCTYASNALPVAVSEEVA

Sequences:

>Translated_793_residues
MDHKLVIVESPAKAKTIQKYLGAGYRVMASMGHVRDLPKSKIGIDIDNDFSPVYEISEGKDKLIAELKREIKTADAIYLA
TDHDREGEAIAWHILQAANIGKRKPVYRITFNEITKDSIQHAIRNPREIDANLVDAQQARRVLDRLVGYKISPILWAKVR
RGLSAGRVQSVAVRMVVEREREIESFVPKEYWTIEADLSPAGLKKLGKHDIFRAILHARNGKKLDKFAIPSKDAADAVLA
ALEGANYLVGTVTRKDKRRSPAPPFITSTLQQEASRKLGFSSKRTMQVAQKLYEGVDIGGKDGTVGLITYMRTDSTNVSV
DAQTEARTLITELYGKEYVPAKPNIYKTKAKGAQEAHEAIRPTSVVRRPDQLKTALGRDEFRLYDLIWKRFMASQMAAAI
FDSTSVDIGAGAGIKTAAGAPFTFRATGSVLKFNGFLAVYNVSLDEGDEDEDKEALLPPLNEGQALDLHDLFGEQHFTTP
PPRYTEATLVKQMESEGIGRPSTYAPTISTIVAREYVELVEKKLMPTTLGRVVTDLLVEHFKDIVDYNFTSDMEQRLDDI
AEGQRRWVPVLREFYDPFAVRLHAAETEMRNVKREEIKTELPCPQCGTHLVIKWGRNGEFLACSRYPECSWTGDLERDGD
GGIHIASQPEIFGNTNCPECDNPMSLKKGRFGPFLACNNYPTCKGIRKVRAQGKDFVVIPPPKPTEEKCPKCNRPMVQKE
GKFGPFLSCTGYPECRSIVRLTPNDAPTCPQCGEGKVVAKRARGGRTFFSCTRYPDCTYASNALPVAVSEEVA
>Mature_793_residues
MDHKLVIVESPAKAKTIQKYLGAGYRVMASMGHVRDLPKSKIGIDIDNDFSPVYEISEGKDKLIAELKREIKTADAIYLA
TDHDREGEAIAWHILQAANIGKRKPVYRITFNEITKDSIQHAIRNPREIDANLVDAQQARRVLDRLVGYKISPILWAKVR
RGLSAGRVQSVAVRMVVEREREIESFVPKEYWTIEADLSPAGLKKLGKHDIFRAILHARNGKKLDKFAIPSKDAADAVLA
ALEGANYLVGTVTRKDKRRSPAPPFITSTLQQEASRKLGFSSKRTMQVAQKLYEGVDIGGKDGTVGLITYMRTDSTNVSV
DAQTEARTLITELYGKEYVPAKPNIYKTKAKGAQEAHEAIRPTSVVRRPDQLKTALGRDEFRLYDLIWKRFMASQMAAAI
FDSTSVDIGAGAGIKTAAGAPFTFRATGSVLKFNGFLAVYNVSLDEGDEDEDKEALLPPLNEGQALDLHDLFGEQHFTTP
PPRYTEATLVKQMESEGIGRPSTYAPTISTIVAREYVELVEKKLMPTTLGRVVTDLLVEHFKDIVDYNFTSDMEQRLDDI
AEGQRRWVPVLREFYDPFAVRLHAAETEMRNVKREEIKTELPCPQCGTHLVIKWGRNGEFLACSRYPECSWTGDLERDGD
GGIHIASQPEIFGNTNCPECDNPMSLKKGRFGPFLACNNYPTCKGIRKVRAQGKDFVVIPPPKPTEEKCPKCNRPMVQKE
GKFGPFLSCTGYPECRSIVRLTPNDAPTCPQCGEGKVVAKRARGGRTFFSCTRYPDCTYASNALPVAVSEEVA

Specific function: The reaction catalyzed by topoisomerases leads to the conversion of one topological isomer of DNA to another [H]

COG id: COG0550

COG function: function code L; Topoisomerase IA

Gene ontology:

Cell location: Cytoplasm [C]

Metaboloic importance: Essential [C]

Operon status: Not Known

Operon components: None

Similarity: Contains 1 Toprim domain [H]

Homologues:

Organism=Homo sapiens, GI10835218, Length=629, Percent_Identity=26.7090620031796, Blast_Score=147, Evalue=5e-35,
Organism=Homo sapiens, GI4507635, Length=739, Percent_Identity=24.3572395128552, Blast_Score=127, Evalue=5e-29,
Organism=Escherichia coli, GI1787529, Length=795, Percent_Identity=40.5031446540881, Blast_Score=527, Evalue=1e-151,
Organism=Escherichia coli, GI48994931, Length=137, Percent_Identity=39.4160583941606, Blast_Score=108, Evalue=1e-24,
Organism=Escherichia coli, GI1788061, Length=558, Percent_Identity=24.7311827956989, Blast_Score=100, Evalue=4e-22,
Organism=Caenorhabditis elegans, GI17555378, Length=550, Percent_Identity=25.8181818181818, Blast_Score=129, Evalue=7e-30,
Organism=Caenorhabditis elegans, GI32563869, Length=588, Percent_Identity=26.1904761904762, Blast_Score=128, Evalue=1e-29,
Organism=Saccharomyces cerevisiae, GI6323263, Length=594, Percent_Identity=26.4309764309764, Blast_Score=118, Evalue=5e-27,
Organism=Drosophila melanogaster, GI24585251, Length=614, Percent_Identity=26.5472312703583, Blast_Score=143, Evalue=4e-34,
Organism=Drosophila melanogaster, GI24640096, Length=600, Percent_Identity=25.5, Blast_Score=129, Evalue=8e-30,

Paralogues:

None

Copy number: NA

Swissprot (AC and ID): NA

Other databases:

- InterPro:   IPR003601
- InterPro:   IPR013497
- InterPro:   IPR013824
- InterPro:   IPR013825
- InterPro:   IPR000380
- InterPro:   IPR003602
- InterPro:   IPR013498
- InterPro:   IPR005733
- InterPro:   IPR006171 [H]

Pfam domain/function: PF01131 Topoisom_bac; PF01751 Toprim; PF01396 zf-C4_Topoisom [H]

EC number: =5.99.1.2 [H]

Molecular weight: Translated: 88356; Mature: 88356

Theoretical pI: Translated: 8.56; Mature: 8.56

Prosite motif: NA

Important sites: NA

Signals:

None

Transmembrane regions:

None

Cys/Met content:

2.0 %Cys     (Translated Protein)
1.8 %Met     (Translated Protein)
3.8 %Cys+Met (Translated Protein)
2.0 %Cys     (Mature Protein)
1.8 %Met     (Mature Protein)
3.8 %Cys+Met (Mature Protein)

Secondary structure:

>Translated Secondary Structure
MDHKLVIVESPAKAKTIQKYLGAGYRVMASMGHVRDLPKSKIGIDIDNDFSPVYEISEGK
CCCEEEEEECCHHHHHHHHHHCCCHHHHHHHHHHHCCCCHHCCEEECCCCCCCEECCCCH
DKLIAELKREIKTADAIYLATDHDREGEAIAWHILQAANIGKRKPVYRITFNEITKDSIQ
HHHHHHHHHHHHHCCEEEEEECCCCCCCHHHHHHHHHHCCCCCCCEEEEEHHHHHHHHHH
HAIRNPREIDANLVDAQQARRVLDRLVGYKISPILWAKVRRGLSAGRVQSVAVRMVVERE
HHHCCCHHCCCHHHHHHHHHHHHHHHHCCCCCHHHHHHHHCCCCCCHHHHHHHHHHHHHH
REIESFVPKEYWTIEADLSPAGLKKLGKHDIFRAILHARNGKKLDKFAIPSKDAADAVLA
HHHHHHCCCCEEEEECCCCHHHHHHHHHHHHHHHHHHHCCCCCCHHHCCCCCHHHHHHHH
ALEGANYLVGTVTRKDKRRSPAPPFITSTLQQEASRKLGFSSKRTMQVAQKLYEGVDIGG
HHCCCCEEEEECCCCCCCCCCCCCHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHCCCCCC
KDGTVGLITYMRTDSTNVSVDAQTEARTLITELYGKEYVPAKPNIYKTKAKGAQEAHEAI
CCCCEEEEEEEEECCCCEEEECCHHHHHHHHHHHCCCCCCCCCCEEECHHCCHHHHHHHH
RPTSVVRRPDQLKTALGRDEFRLYDLIWKRFMASQMAAAIFDSTSVDIGAGAGIKTAAGA
CCHHHHCCCHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCC
PFTFRATGSVLKFNGFLAVYNVSLDEGDEDEDKEALLPPLNEGQALDLHDLFGEQHFTTP
CEEEECCCCEEEECCEEEEEEEECCCCCCCCCCCCCCCCCCCCCEECHHHHHCCCCCCCC
PPRYTEATLVKQMESEGIGRPSTYAPTISTIVAREYVELVEKKLMPTTLGRVVTDLLVEH
CCCCHHHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHH
FKDIVDYNFTSDMEQRLDDIAEGQRRWVPVLREFYDPFAVRLHAAETEMRNVKREEIKTE
HHHHHCCCCCHHHHHHHHHHHCCHHHHHHHHHHHCCCHHEEEEHHHHHHHHHHHHHHHHC
LPCPQCGTHLVIKWGRNGEFLACSRYPECSWTGDLERDGDGGIHIASQPEIFGNTNCPEC
CCCCCCCCEEEEEECCCCCEEEECCCCCCCCCCCCCCCCCCCEEECCCCCCCCCCCCCCC
DNPMSLKKGRFGPFLACNNYPTCKGIRKVRAQGKDFVVIPPPKPTEEKCPKCNRPMVQKE
CCCCCCCCCCCCCEEEECCCCCHHHHHHHHHCCCCEEEECCCCCCHHHCCCCCCCCHHCC
GKFGPFLSCTGYPECRSIVRLTPNDAPTCPQCGEGKVVAKRARGGRTFFSCTRYPDCTYA
CCCCCEEECCCCHHHHHHEEECCCCCCCCCCCCCCCEEEECCCCCCEEEEECCCCCCCCC
SNALPVAVSEEVA
CCCCCEECCCCCC
>Mature Secondary Structure
MDHKLVIVESPAKAKTIQKYLGAGYRVMASMGHVRDLPKSKIGIDIDNDFSPVYEISEGK
CCCEEEEEECCHHHHHHHHHHCCCHHHHHHHHHHHCCCCHHCCEEECCCCCCCEECCCCH
DKLIAELKREIKTADAIYLATDHDREGEAIAWHILQAANIGKRKPVYRITFNEITKDSIQ
HHHHHHHHHHHHHCCEEEEEECCCCCCCHHHHHHHHHHCCCCCCCEEEEEHHHHHHHHHH
HAIRNPREIDANLVDAQQARRVLDRLVGYKISPILWAKVRRGLSAGRVQSVAVRMVVERE
HHHCCCHHCCCHHHHHHHHHHHHHHHHCCCCCHHHHHHHHCCCCCCHHHHHHHHHHHHHH
REIESFVPKEYWTIEADLSPAGLKKLGKHDIFRAILHARNGKKLDKFAIPSKDAADAVLA
HHHHHHCCCCEEEEECCCCHHHHHHHHHHHHHHHHHHHCCCCCCHHHCCCCCHHHHHHHH
ALEGANYLVGTVTRKDKRRSPAPPFITSTLQQEASRKLGFSSKRTMQVAQKLYEGVDIGG
HHCCCCEEEEECCCCCCCCCCCCCHHHHHHHHHHHHHCCCCHHHHHHHHHHHHHCCCCCC
KDGTVGLITYMRTDSTNVSVDAQTEARTLITELYGKEYVPAKPNIYKTKAKGAQEAHEAI
CCCCEEEEEEEEECCCCEEEECCHHHHHHHHHHHCCCCCCCCCCEEECHHCCHHHHHHHH
RPTSVVRRPDQLKTALGRDEFRLYDLIWKRFMASQMAAAIFDSTSVDIGAGAGIKTAAGA
CCHHHHCCCHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHCCCCCCCCCCCCCCCCCCC
PFTFRATGSVLKFNGFLAVYNVSLDEGDEDEDKEALLPPLNEGQALDLHDLFGEQHFTTP
CEEEECCCCEEEECCEEEEEEEECCCCCCCCCCCCCCCCCCCCCEECHHHHHCCCCCCCC
PPRYTEATLVKQMESEGIGRPSTYAPTISTIVAREYVELVEKKLMPTTLGRVVTDLLVEH
CCCCHHHHHHHHHHHCCCCCCCCCCHHHHHHHHHHHHHHHHHHCCHHHHHHHHHHHHHHH
FKDIVDYNFTSDMEQRLDDIAEGQRRWVPVLREFYDPFAVRLHAAETEMRNVKREEIKTE
HHHHHCCCCCHHHHHHHHHHHCCHHHHHHHHHHHCCCHHEEEEHHHHHHHHHHHHHHHHC
LPCPQCGTHLVIKWGRNGEFLACSRYPECSWTGDLERDGDGGIHIASQPEIFGNTNCPEC
CCCCCCCCEEEEEECCCCCEEEECCCCCCCCCCCCCCCCCCCEEECCCCCCCCCCCCCCC
DNPMSLKKGRFGPFLACNNYPTCKGIRKVRAQGKDFVVIPPPKPTEEKCPKCNRPMVQKE
CCCCCCCCCCCCCEEEECCCCCHHHHHHHHHCCCCEEEECCCCCCHHHCCCCCCCCHHCC
GKFGPFLSCTGYPECRSIVRLTPNDAPTCPQCGEGKVVAKRARGGRTFFSCTRYPDCTYA
CCCCCEEECCCCHHHHHHEEECCCCCCCCCCCCCCCEEEECCCCCCEEEEECCCCCCCCC
SNALPVAVSEEVA
CCCCCEECCCCCC

PDB accession: NA

Resolution: NA

Structure class: Unstructured

Cofactors: NA

Metal ions: NA

Kcat value (1/min): NA

Specific activity: NA

Km value (mM): NA

Substrates: NA

Specific reaction: NA

General reaction: NA

Inhibitor: NA

Structure determination priority: 9.0

TargetDB status: NA

Availability: NA

References: 11058132 [H]