| Definition | Mycobacterium tuberculosis F11, complete genome. |
|---|---|
| Accession | NC_009565 |
| Length | 4,424,435 |
Click here to switch to the map view.
The map label for this gene is arsB [C]
Identifier: 148823874
GI number: 148823874
Start: 3012569
End: 3013858
Strand: Direct
Name: arsB [C]
Synonym: TBFG_12699
Alternate gene names: 148823874
Gene position: 3012569-3013858 (Clockwise)
Preceding gene: 148823873
Following gene: 148823875
Centisome position: 68.09
GC content: 62.87
Gene sequence:
>1290_bases GTGAGCGTCGTCGCGGTCACCATCTTCGTGGCGGCCTACGTTCTGATTGCCAGCGATCGCGTCAACAAGACGATGGTGGC GCTGACCGGCGCGGCGGCCGTGGTCGTCCTACCAGTGATCACATCCCACGACATCTTCTATTCCCACGACACCGGAATCG ACTGGGACGTCATTTTCTTGTTGGTGGGCATGATGATCATCGTCGGAGTGCTGCGGCAGACGGGGGTGTTCGAATACACC GCGATCTGGGCCGCCAAGCGCGCCCGCGGCTCGCCGCTACGCATCATGATCCTGCTGGTATTGGTGAGCGCGTTGGCGTC AGCCTTGCTGGATAACGTCACCACGGTGTTGTTGATCGCGCCGGTCACGCTATTGGTGTGCGACCGGTTAAACATCAACA CGACGTCGTTCCTGATGGCCGAAGTCTTCGCCTCCAACATTGGTGGCGCCGCGACGTTGGTGGGTGACCCGCCGAACATC ATCGTGGCCAGCCGGGCGGGATTGACGTTCAACGACTTCATGCTGCACTTGACACCGCTGGTAGTCATTGTGCTGATCGC CCTCATCGCTGTGCTGCCCCGCCTGTTCGGCTCGATCACGGTCGAAGCCGATCGAATTGCCGATGTCATGGCGCTCGACG AGGGTGAAGCCATCCGCGACCGCGGACTGCTGGTCAAATGTGGCGCCGTGCTGGTGCTGGTGTTCGCGGCCTTCGTCGCC CATCCGGTGCTGCACATCCAGCCTTCTCTAGTGGCGCTGCTGGGCGCTGGGATGCTGATCGTGGTCTCGGGTCTGACGCG ATCCGAGTATCTATCCAGCGTCGAGTGGGACACGCTGCTGTTTTTCGCCGGGCTGTTCATTATGGTCGGAGCGCTGGTCA AGACCGGTGTCGTCAACGATCTCGCGCGGGCAGCGACCCAGCTGACCGGCGGCAATATTGTGGCCACCGCGTTCCTAATC CTCGGCGTCTCCGCCCCGATCTCGGGAATTATCGACAACATTCCCTACGTCGCCACGATGACGCCCCTCGTCGCGGAGCT GGTCGCGGTCATGGGGGGTCAACCCAGCACCGACACCCCCTGGTGGGCGCTGGCCCTGGGTGCCGACTTCGGCGGCAACC TGACCGCAATCGGCGCCAGCGCGAACGTCGTCATGCTCGGAATCGCCCGGCGCGCAGGAGCTCCCATCTCGTTCTGGGAG TTCACCCGCAAAGGGGCGGTGGTCACGGCCGTCTCGATCGCGCTCGCGGCGATCTACCTGTGGTTGCGGTACTTCGTGTT GTTGCACTGA
Upstream 100 bases:
>100_bases CGGCTGCGCAGCCCATTGCTCGCGGTGGTCAAAGACGGCTCGCTGCTCGGGGTGGTCACCGCATCGCGCCTGCTTGCTGC GGCACTGAAGACTTGACCTC
Downstream 100 bases:
>100_bases CCATCTGTATTGCCGACAGACCTGTAGCACCAGACGACGCCGCGATGAGCGGCCTACGAGAAGATTCGGAGGATGGCCGA TGAGCATCATCGCCATCACG
Product: arsenic-transport integral membrane protein arsA
Products: ADP; phosphate; arsenite [Periplasm] [C]
Alternate protein names: NA
Number of amino acids: Translated: 429; Mature: 428
Protein sequence:
>429_residues MSVVAVTIFVAAYVLIASDRVNKTMVALTGAAAVVVLPVITSHDIFYSHDTGIDWDVIFLLVGMMIIVGVLRQTGVFEYT AIWAAKRARGSPLRIMILLVLVSALASALLDNVTTVLLIAPVTLLVCDRLNINTTSFLMAEVFASNIGGAATLVGDPPNI IVASRAGLTFNDFMLHLTPLVVIVLIALIAVLPRLFGSITVEADRIADVMALDEGEAIRDRGLLVKCGAVLVLVFAAFVA HPVLHIQPSLVALLGAGMLIVVSGLTRSEYLSSVEWDTLLFFAGLFIMVGALVKTGVVNDLARAATQLTGGNIVATAFLI LGVSAPISGIIDNIPYVATMTPLVAELVAVMGGQPSTDTPWWALALGADFGGNLTAIGASANVVMLGIARRAGAPISFWE FTRKGAVVTAVSIALAAIYLWLRYFVLLH
Sequences:
>Translated_429_residues MSVVAVTIFVAAYVLIASDRVNKTMVALTGAAAVVVLPVITSHDIFYSHDTGIDWDVIFLLVGMMIIVGVLRQTGVFEYT AIWAAKRARGSPLRIMILLVLVSALASALLDNVTTVLLIAPVTLLVCDRLNINTTSFLMAEVFASNIGGAATLVGDPPNI IVASRAGLTFNDFMLHLTPLVVIVLIALIAVLPRLFGSITVEADRIADVMALDEGEAIRDRGLLVKCGAVLVLVFAAFVA HPVLHIQPSLVALLGAGMLIVVSGLTRSEYLSSVEWDTLLFFAGLFIMVGALVKTGVVNDLARAATQLTGGNIVATAFLI LGVSAPISGIIDNIPYVATMTPLVAELVAVMGGQPSTDTPWWALALGADFGGNLTAIGASANVVMLGIARRAGAPISFWE FTRKGAVVTAVSIALAAIYLWLRYFVLLH >Mature_428_residues SVVAVTIFVAAYVLIASDRVNKTMVALTGAAAVVVLPVITSHDIFYSHDTGIDWDVIFLLVGMMIIVGVLRQTGVFEYTA IWAAKRARGSPLRIMILLVLVSALASALLDNVTTVLLIAPVTLLVCDRLNINTTSFLMAEVFASNIGGAATLVGDPPNII VASRAGLTFNDFMLHLTPLVVIVLIALIAVLPRLFGSITVEADRIADVMALDEGEAIRDRGLLVKCGAVLVLVFAAFVAH PVLHIQPSLVALLGAGMLIVVSGLTRSEYLSSVEWDTLLFFAGLFIMVGALVKTGVVNDLARAATQLTGGNIVATAFLIL GVSAPISGIIDNIPYVATMTPLVAELVAVMGGQPSTDTPWWALALGADFGGNLTAIGASANVVMLGIARRAGAPISFWEF TRKGAVVTAVSIALAAIYLWLRYFVLLH
Specific function: Involved In Arsenical Resistance. Thought To Form The Channel Of An Arsenite Pump (By Similarity). [C]
COG id: COG1055
COG function: function code P; Na+/H+ antiporter NhaD and related arsenite permeases
Gene ontology:
Cell location: Cell membrane; Multi-pass membrane protein (Probable)
Metaboloic importance: Non_Essential [C]
Operon status: Not Known
Operon components: None
Similarity: Belongs to the CitM (TC 2.A.11) transporter family
Homologues:
Organism=Homo sapiens, GI157266326, Length=167, Percent_Identity=38.9221556886228, Blast_Score=120, Evalue=2e-27, Organism=Escherichia coli, GI87082277, Length=384, Percent_Identity=24.21875, Blast_Score=67, Evalue=3e-12, Organism=Escherichia coli, GI1787039, Length=133, Percent_Identity=28.5714285714286, Blast_Score=64, Evalue=2e-11, Organism=Drosophila melanogaster, GI45550608, Length=479, Percent_Identity=31.3152400835073, Blast_Score=142, Evalue=5e-34, Organism=Drosophila melanogaster, GI85724998, Length=480, Percent_Identity=25.625, Blast_Score=126, Evalue=3e-29, Organism=Drosophila melanogaster, GI62484377, Length=480, Percent_Identity=25.625, Blast_Score=125, Evalue=4e-29, Organism=Drosophila melanogaster, GI24581759, Length=204, Percent_Identity=38.2352941176471, Blast_Score=123, Evalue=2e-28, Organism=Drosophila melanogaster, GI19920704, Length=204, Percent_Identity=38.2352941176471, Blast_Score=123, Evalue=2e-28, Organism=Drosophila melanogaster, GI28574683, Length=204, Percent_Identity=38.2352941176471, Blast_Score=123, Evalue=2e-28, Organism=Drosophila melanogaster, GI28574681, Length=204, Percent_Identity=38.2352941176471, Blast_Score=123, Evalue=2e-28, Organism=Drosophila melanogaster, GI28574685, Length=204, Percent_Identity=38.2352941176471, Blast_Score=123, Evalue=2e-28, Organism=Drosophila melanogaster, GI28574678, Length=204, Percent_Identity=38.2352941176471, Blast_Score=123, Evalue=2e-28, Organism=Drosophila melanogaster, GI24656008, Length=463, Percent_Identity=25.4859611231102, Blast_Score=100, Evalue=3e-21, Organism=Drosophila melanogaster, GI221472711, Length=223, Percent_Identity=33.6322869955157, Blast_Score=92, Evalue=1e-18, Organism=Drosophila melanogaster, GI24581764, Length=223, Percent_Identity=33.6322869955157, Blast_Score=90, Evalue=3e-18,
Paralogues:
None
Copy number: NA
Swissprot (AC and ID): Y2684_MYCTU (P0A606)
Other databases:
- EMBL: BX842580 - EMBL: AE000516 - PIR: G70528 - RefSeq: NP_217200.1 - RefSeq: NP_337259.1 - ProteinModelPortal: P0A606 - EnsemblBacteria: EBMYCT00000003901 - EnsemblBacteria: EBMYCT00000071780 - GeneID: 888366 - GeneID: 925538 - GenomeReviews: AE000516_GR - GenomeReviews: AL123456_GR - KEGG: mtc:MT2758 - KEGG: mtu:Rv2684 - TIGR: MT2758 - TubercuList: Rv2684 - GeneTree: EBGT00050000016378 - HOGENOM: HBG727257 - OMA: ASSMSHE - ProtClustDB: CLSK792003 - InterPro: IPR000802 - InterPro: IPR004680 - PRINTS: PR00758
Pfam domain/function: PF03600 CitMHS
EC number: NA
Molecular weight: Translated: 45188; Mature: 45057
Theoretical pI: Translated: 5.94; Mature: 5.94
Prosite motif: NA
Important sites: NA
Signals:
None
Transmembrane regions:
HASH(0x1c471b50)-; HASH(0x1c8e50ac)-; HASH(0x1c942e38)-; HASH(0x1c93d310)-; HASH(0x1c5f69c8)-; HASH(0x1c92df9c)-; HASH(0x1c8e4dc4)-; HASH(0x1c93d5bc)-; HASH(0x1b4b15b0)-; HASH(0x1c4cfeb0)-;
Cys/Met content:
0.5 %Cys (Translated Protein) 3.0 %Met (Translated Protein) 3.5 %Cys+Met (Translated Protein) 0.5 %Cys (Mature Protein) 2.8 %Met (Mature Protein) 3.3 %Cys+Met (Mature Protein)
Secondary structure:
>Translated Secondary Structure MSVVAVTIFVAAYVLIASDRVNKTMVALTGAAAVVVLPVITSHDIFYSHDTGIDWDVIFL CCHHHHHHHHHHHHHHHCCCCCCCCEEECCHHHHHHHHHHHCCCEEEECCCCCCHHHHHH LVGMMIIVGVLRQTGVFEYTAIWAAKRARGSPLRIMILLVLVSALASALLDNVTTVLLIA HHHHHHHHHHHHHCCCHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHH PVTLLVCDRLNINTTSFLMAEVFASNIGGAATLVGDPPNIIVASRAGLTFNDFMLHLTPL HHHHHHHCCCCCCHHHHHHHHHHHHCCCCCEEEECCCCCEEEEECCCCCHHHHHHHHHHH VVIVLIALIAVLPRLFGSITVEADRIADVMALDEGEAIRDRGLLVKCGAVLVLVFAAFVA HHHHHHHHHHHHHHHHCCEEEEHHHHHHHHHCCCCCHHHHCCCEEHHHHHHHHHHHHHHH HPVLHIQPSLVALLGAGMLIVVSGLTRSEYLSSVEWDTLLFFAGLFIMVGALVKTGVVND CCHHHCCHHHHHHHCCCCEEEEECCCHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHH LARAATQLTGGNIVATAFLILGVSAPISGIIDNIPYVATMTPLVAELVAVMGGQPSTDTP HHHHHHHCCCCHHHHHHHHHHHCCCCHHHHHHCCCHHHHHHHHHHHHHHHHCCCCCCCCC WWALALGADFGGNLTAIGASANVVMLGIARRAGAPISFWEFTRKGAVVTAVSIALAAIYL EEEEEECCCCCCCEEEECCCCCEEEEEEHHHCCCCCHHHHHHCCCHHHHHHHHHHHHHHH WLRYFVLLH HHHHHHHCH >Mature Secondary Structure SVVAVTIFVAAYVLIASDRVNKTMVALTGAAAVVVLPVITSHDIFYSHDTGIDWDVIFL CHHHHHHHHHHHHHHHCCCCCCCCEEECCHHHHHHHHHHHCCCEEEECCCCCCHHHHHH LVGMMIIVGVLRQTGVFEYTAIWAAKRARGSPLRIMILLVLVSALASALLDNVTTVLLIA HHHHHHHHHHHHHCCCHHHHHHHHHHHCCCCCHHHHHHHHHHHHHHHHHHHHHHHHHHHH PVTLLVCDRLNINTTSFLMAEVFASNIGGAATLVGDPPNIIVASRAGLTFNDFMLHLTPL HHHHHHHCCCCCCHHHHHHHHHHHHCCCCCEEEECCCCCEEEEECCCCCHHHHHHHHHHH VVIVLIALIAVLPRLFGSITVEADRIADVMALDEGEAIRDRGLLVKCGAVLVLVFAAFVA HHHHHHHHHHHHHHHHCCEEEEHHHHHHHHHCCCCCHHHHCCCEEHHHHHHHHHHHHHHH HPVLHIQPSLVALLGAGMLIVVSGLTRSEYLSSVEWDTLLFFAGLFIMVGALVKTGVVND CCHHHCCHHHHHHHCCCCEEEEECCCHHHHHHHCCHHHHHHHHHHHHHHHHHHHHHHHHH LARAATQLTGGNIVATAFLILGVSAPISGIIDNIPYVATMTPLVAELVAVMGGQPSTDTP HHHHHHHCCCCHHHHHHHHHHHCCCCHHHHHHCCCHHHHHHHHHHHHHHHHCCCCCCCCC WWALALGADFGGNLTAIGASANVVMLGIARRAGAPISFWEFTRKGAVVTAVSIALAAIYL EEEEEECCCCCCCEEEECCCCCEEEEEEHHHCCCCCHHHHHHCCCHHHHHHHHHHHHHHH WLRYFVLLH HHHHHHHCH
PDB accession: NA
Resolution: NA
Structure class: Unstructured
Cofactors: NA
Metal ions: NA
Kcat value (1/min): NA
Specific activity: NA
Km value (mM): NA
Substrates: ATP; arsenite [Cytoplasm]; H2O [C]
Specific reaction: ATP + arsenite [Cytoplasm] + H2O = ADP + phosphate + arsenite [Periplasm] [C]
General reaction: NA
Inhibitor: NA
Structure determination priority: 6.0
TargetDB status: NA
Availability: NA
References: 9634230; 12218036